GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →
Model Intelligence Sheet

grapeV-ai/Qwen3.6-27B-MTP-GGUF overview

What is this? Qwen3.6 27B https://huggingface.co/Qwen/Qwen3.6 27B を MTP(=マルチトークン予測)レイヤーを含めて GGUFフォーマットに変換したものです。 Note 引数に spec type draft mtp spec draft n max …

gguflicense:apache-2.0endpoints_compatibleregion:usconversational

Runs locally from ~13.0 MB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).

Downloads
0
Likes
0
Pipeline
Author

Repository Files & Downloads

9 GGUF files detected
Direct downloads for local inference
FileTypeQuantizationSizeLink
Qwen3.6-27B-BF16.ggufGGUFBF1650.90 GBDownload
Qwen3.6-27B-IQ4_XS.ggufGGUFIQ4_XS14.26 GBDownload
Qwen3.6-27B-Q4_K_M.ggufGGUFQ4_K_M15.66 GBDownload
Qwen3.6-27B-Q5_K_M.ggufGGUFQ5_K_M18.19 GBDownload
Qwen3.6-27B-Q6_K.ggufGGUFQ6_K20.89 GBDownload
Qwen3.6-27B-imatrix.ggufGGUFGGUF13.0 MBDownload
mmproj-Qwen3.6-27b-BF16.ggufGGUFBF16888.0 MBDownload
mmproj-Qwen3.6-27b-Q8_0.ggufGGUFQ8_0600.1 MBDownload
mtp-Qwen3.6-27b-BF16.ggufGGUFBF165.54 GBDownload

Model Details

Model IDgrapeV-ai/Qwen3.6-27B-MTP-GGUF
AuthorgrapeV-ai
Pipeline
Licenseapache-2.0
Base model
Last modified2026-08-25T12:54:37.000Z

Model README

---

license: apache-2.0

---

What is this?

Qwen3.6-27BMTP(=マルチトークン予測)レイヤーを含めてGGUFフォーマットに変換したものです。

Note

引数に--spec-type draft-mtp --spec-draft-n-max 2と追加することでMTPが有効化されます。<br>

なお、--spec-draft-n-maxについては、日本語では2がスイートスポットのようです。

License

Apache 2.0

Developer

Alibaba Cloud

Run grapeV-ai/Qwen3.6-27B-MTP-GGUF with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models

Source: Hugging Face · Compare models