ynanxiu/qwen25-3b-coffee-lora-gguf overview
language: zh license: apache 2.0 tags: qwen2.5 3b gguf coffee llama.cpp q4 k m chat pipeline tag: text generation ☕ Qwen2.5 3B Coffee Master Chat Q4 K M quanti…
Runs locally from ~1.80 GB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).
Repository Files & Downloads
| File | Type | Quantization | Size | Link |
|---|---|---|---|---|
| archive/v21/qwen25_3b_coffee_v21_q4km.gguf | GGUF | Q4KM | 1.80 GB | Download |
| archive/v22/qwen25_3b_coffee_v22_q4km.gguf | GGUF | Q4KM | 1.80 GB | Download |
| archive/v25/qwen25_3b_coffee_v25_q4km.gguf | GGUF | Q4KM | 1.80 GB | Download |
| archive/v26/qwen25_3b_coffee_v26_q4km.gguf | GGUF | Q4KM | 1.80 GB | Download |
| archive/v34/qwen25_3b_coffee_v34_q4km.gguf | GGUF | Q4KM | 1.80 GB | Download |
| archive/v37/qwen25_3b_coffee_v37_q4km.gguf | GGUF | Q4KM | 1.80 GB | Download |
| archive/v39c/qwen25_3b_coffee_v39c_q4km.gguf | GGUF | Q4KM | 1.80 GB | Download |
| archive/v41/qwen25_3b_coffee_v41_q4km.gguf | GGUF | Q4KM | 1.80 GB | Download |
| qwen25_3b_coffee_barista_v43_q4km.gguf | GGUF | Q4KM | 1.80 GB | Download |
| qwen25_3b_coffee_latest_q4km.gguf | GGUF | Q4KM | 1.80 GB | Download |
Model Details
| Model ID | ynanxiu/qwen25-3b-coffee-lora-gguf |
|---|---|
| Author | ynanxiu |
| Pipeline | text-generation |
| License | apache-2.0 |
| Base model | — |
| Last modified | 2026-07-05T16:22:13.000Z |
Model README
---
language: zh
license: apache-2.0
tags:
- qwen2.5
- 3b
- gguf
- coffee
- llama.cpp
- q4_k_m
- chat
pipeline_tag: text-generation
---
☕ Qwen2.5-3B Coffee Master (Chat)
Q4_K_M quantized GGUF for llama.cpp. 1.93 GB.
Latest: v43
纯对话版本 — 不含工具调用。
这是一个咖啡师聊天模型,专注于自然、专业的咖啡对话。❌ 不支持 function calling / tool calling。如果你需要带工具调用(价格查询)的版本,请使用 v41。
能力
| 维度 | 得分 | 说明 |
|------|:---:|------|
| 知识问答 | 15/15 (100%) | 深烘水温、手冲参数、浓缩参数等 |
| 场景推荐 | 5/6 | 新手/提神/减肥/不喜酸/失眠 |
| 回复简洁度 | 128ch 均长 | 比 v42 (198ch) 缩短 35% |
| 退化循环 | 0 次 | 完全消除"复读机"问题 |
| 工具调用 | 不支持 | 纯聊天,不含 <tool_call> |
知识亮点
- ✅ 深烘手冲水温:85-90°C(准确区分烘焙温度 vs 冲煮水温)
- ✅ 浅烘手冲水温:92-94°C
- ✅ 粉水比:1:15
- ✅ 浓缩参数:1:2, 25-30s
- ✅ 法压壶:浸泡 4 分钟
- ✅ 冷萃:浸泡 12-24 小时
Usage
# CPU-only
llama-cli -m qwen25_3b_coffee_barista_v43_q4km.gguf -ngl 0 -c 2048
System Prompt
你是一个专业咖啡师,拥有丰富的咖啡知识和吧台经验。用自然、亲切的中文回答,像在跟熟客聊天一样。回复简洁、有人情味,1-3句话。
推荐参数
| 参数 | 值 | 说明 |
|------|-----|------|
| max_tokens | 100 | 防过长回复 |
| repeat_penalty | 1.15 | 防复读机 |
| stop | \n\n | 自然段落处停 |
| temperature | 0.7 | 有变化不胡言 |
历史版本
| 版本 | 类型 | 说明 |
|------|------|------|
| v43 | Chat | 🏆 当前最新,纯聊天 |
| v41 | Tool | 工具调用版(价格查询) |
| v37 | Tool | 工具调用版(统一格式) |
LoRA Adapter
PEFT adapter: qwen25-3b-coffee-lora
Demo
在线体验: coffee-master Space
Run ynanxiu/qwen25-3b-coffee-lora-gguf with guIDE
Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.
Source: Hugging Face · Compare models