GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →
Model Intelligence Sheet

grapeV-ai/Qwen3.5-27B-DFlash-GGUF overview

What is this? Qwen3.5 27B https://huggingface.co/Qwen/Qwen3.5 27B の投機的デコード用モジュール Qwen3.5 27B DFlash https://huggingface.co/z lab/Qwen3.5 27B DFlash/tree/main を…

gguflicense:apache-2.0endpoints_compatibleregion:usconversational

Runs locally from ~883.0 MB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).

Downloads
0
Likes
0
Pipeline
Author

Repository Files & Downloads

7 GGUF files detected
Direct downloads for local inference
FileTypeQuantizationSizeLink
Qwen3.5-27B-DFlash-BF16.ggufGGUFBF163.98 GBDownload
Qwen3.5-27B-DFlash-Q3_K_L.ggufGGUFQ3_K_L1.03 GBDownload
Qwen3.5-27B-DFlash-Q3_K_M.ggufGGUFQ3_K_M971.9 MBDownload
Qwen3.5-27B-DFlash-Q3_K_S.ggufGGUFQ3_K_S883.0 MBDownload
Qwen3.5-27B-DFlash-Q4_K_M.ggufGGUFQ4_K_M1.17 GBDownload
Qwen3.5-27B-DFlash-Q5_K_M.ggufGGUFQ5_K_M1.40 GBDownload
Qwen3.5-27B-DFlash-Q6_K.ggufGGUFQ6_K1.64 GBDownload

Model Details

Model IDgrapeV-ai/Qwen3.5-27B-DFlash-GGUF
AuthorgrapeV-ai
Pipeline
Licenseapache-2.0
Base model
Last modified2026-08-12T10:06:06.000Z

Model README

---

license: apache-2.0

---

What is this?

Qwen3.5-27Bの投機的デコード用モジュールQwen3.5-27B-DFlashをGGUFフォーマットに変換したものです。<br>

こちらのGGUFは単体ではご利用いただけません。Qwen3.5-27B本体のGGUFと併せて使用することで、トークン生成を高速化できます。

Note

-md このGGUFのパス --spec-type draft-dflash --spec-draft-n-max 3引数でDFlash投機的デコードが有効化されます。<br>

なお、--spec-draft-n-max引数については、日本語では3がスイートスポットのようです。

License

Apache 2.0

Developer

z-lab

Run grapeV-ai/Qwen3.5-27B-DFlash-GGUF with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models

Source: Hugging Face · Compare models