GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →
Model Intelligence Sheet

ynanxiu/qwen25-3b-coffee-lora-gguf overview

language: zh license: apache 2.0 tags: qwen2.5 3b gguf coffee llama.cpp q4 k m chat pipeline tag: text generation ☕ Qwen2.5 3B Coffee Master Chat Q4 K M quanti…

safetensorsggufqwen2.53bcoffeellama.cppq4_k_mchattext-generationzhlicense:apache-2.0endpoints_compatibleregion:usconversational

Runs locally from ~1.80 GB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).

Downloads
5,475
Likes
0
Pipeline
text-generation
Author

Repository Files & Downloads

10 GGUF files detected
Direct downloads for local inference
FileTypeQuantizationSizeLink
archive/v21/qwen25_3b_coffee_v21_q4km.ggufGGUFQ4KM1.80 GBDownload
archive/v22/qwen25_3b_coffee_v22_q4km.ggufGGUFQ4KM1.80 GBDownload
archive/v25/qwen25_3b_coffee_v25_q4km.ggufGGUFQ4KM1.80 GBDownload
archive/v26/qwen25_3b_coffee_v26_q4km.ggufGGUFQ4KM1.80 GBDownload
archive/v34/qwen25_3b_coffee_v34_q4km.ggufGGUFQ4KM1.80 GBDownload
archive/v37/qwen25_3b_coffee_v37_q4km.ggufGGUFQ4KM1.80 GBDownload
archive/v39c/qwen25_3b_coffee_v39c_q4km.ggufGGUFQ4KM1.80 GBDownload
archive/v41/qwen25_3b_coffee_v41_q4km.ggufGGUFQ4KM1.80 GBDownload
qwen25_3b_coffee_barista_v43_q4km.ggufGGUFQ4KM1.80 GBDownload
qwen25_3b_coffee_latest_q4km.ggufGGUFQ4KM1.80 GBDownload

Model Details

Model IDynanxiu/qwen25-3b-coffee-lora-gguf
Authorynanxiu
Pipelinetext-generation
Licenseapache-2.0
Base model
Last modified2026-07-05T16:22:13.000Z

Model README

---

language: zh

license: apache-2.0

tags:

  • qwen2.5
  • 3b
  • gguf
  • coffee
  • llama.cpp
  • q4_k_m
  • chat

pipeline_tag: text-generation

---

☕ Qwen2.5-3B Coffee Master (Chat)

Q4_K_M quantized GGUF for llama.cpp. 1.93 GB.

Latest: v43

纯对话版本 — 不含工具调用。

这是一个咖啡师聊天模型,专注于自然、专业的咖啡对话。❌ 不支持 function calling / tool calling。如果你需要带工具调用(价格查询)的版本,请使用 v41

能力

| 维度 | 得分 | 说明 |

|------|:---:|------|

| 知识问答 | 15/15 (100%) | 深烘水温、手冲参数、浓缩参数等 |

| 场景推荐 | 5/6 | 新手/提神/减肥/不喜酸/失眠 |

| 回复简洁度 | 128ch 均长 | 比 v42 (198ch) 缩短 35% |

| 退化循环 | 0 次 | 完全消除"复读机"问题 |

| 工具调用 | 不支持 | 纯聊天,不含 <tool_call> |

知识亮点

  • ✅ 深烘手冲水温:85-90°C(准确区分烘焙温度 vs 冲煮水温)
  • ✅ 浅烘手冲水温:92-94°C
  • ✅ 粉水比:1:15
  • ✅ 浓缩参数:1:2, 25-30s
  • ✅ 法压壶:浸泡 4 分钟
  • ✅ 冷萃:浸泡 12-24 小时

Usage

# CPU-only
llama-cli -m qwen25_3b_coffee_barista_v43_q4km.gguf -ngl 0 -c 2048

System Prompt

你是一个专业咖啡师,拥有丰富的咖啡知识和吧台经验。用自然、亲切的中文回答,像在跟熟客聊天一样。回复简洁、有人情味,1-3句话。

推荐参数

| 参数 | 值 | 说明 |

|------|-----|------|

| max_tokens | 100 | 防过长回复 |

| repeat_penalty | 1.15 | 防复读机 |

| stop | \n\n | 自然段落处停 |

| temperature | 0.7 | 有变化不胡言 |

历史版本

| 版本 | 类型 | 说明 |

|------|------|------|

| v43 | Chat | 🏆 当前最新,纯聊天 |

| v41 | Tool | 工具调用版(价格查询) |

| v37 | Tool | 工具调用版(统一格式) |

LoRA Adapter

PEFT adapter: qwen25-3b-coffee-lora

Demo

在线体验: coffee-master Space

Run ynanxiu/qwen25-3b-coffee-lora-gguf with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models

Source: Hugging Face · Compare models