BahamutRU/Qwen3.6-35B-A3B-REAM-160-ru-agent-GGUF-MTPLess overview
Qwen3.6 35B A3B REAM 160 ru agent GGUF MTPLess MTPLess GGUF variants of WaveCut/Qwen3.6 35B A3B REAM 160 ru agent https://huggingface.co/WaveCut/Qwen3.6 35B A3…
Runs locally from ~3.34 GB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).
Repository Files & Downloads
| File | Type | Quantization | Size | Link |
|---|---|---|---|---|
| Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ1_M-MTPLess.gguf | GGUF | IQ1_M | 5.15 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ1_S-MTPLess.gguf | GGUF | IQ1_S | 4.71 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ2_M-MTPLess.gguf | GGUF | IQ2_M | 7.19 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ2_S-MTPLess.gguf | GGUF | IQ2_S | 6.60 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ2_XS-MTPLess.gguf | GGUF | IQ2_XS | 6.49 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ2_XXS-MTPLess.gguf | GGUF | IQ2_XXS | 5.90 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ3_M-MTPLess.gguf | GGUF | IQ3_M | 9.45 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ3_S-MTPLess.gguf | GGUF | IQ3_S | 9.34 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ3_XS-MTPLess.gguf | GGUF | IQ3_XS | 8.89 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ3_XXS-MTPLess.gguf | GGUF | IQ3_XXS | 8.35 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ4_NL-MTPLess.gguf | GGUF | IQ4_NL | 12.06 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ4_XS-MTPLess.gguf | GGUF | IQ4_XS | 11.44 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-MXFP4_MOE-MTPLess.gguf | GGUF | GGUF | 12.43 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-Q1_0-MTPLess.gguf | GGUF | Q1_0 | 3.34 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-Q2_K-MTPLess.gguf | GGUF | Q2_K | 7.95 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-Q2_K_S-MTPLess.gguf | GGUF | Q2_K_S | 7.49 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-Q3_K_L-MTPLess.gguf | GGUF | Q3_K_L | 11.04 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-Q3_K_M-MTPLess.gguf | GGUF | Q3_K_M | 10.23 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-Q3_K_S-MTPLess.gguf | GGUF | Q3_K_S | 9.28 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-Q4_0-MTPLess.gguf | GGUF | Q4_0 | 12.05 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-Q4_1-MTPLess.gguf | GGUF | Q4_1 | 13.29 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-Q4_K_M-MTPLess.gguf | GGUF | Q4_K_M | 12.87 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-Q4_K_S-MTPLess.gguf | GGUF | Q4_K_S | 12.11 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-WC-Q3_K_XL-MTPLess.gguf | GGUF | Q3_K_XL | 10.75 GB | Download |
| Qwen3.6-35B-A3B-REAM-160-ru-agent-WC-Q4_K_XL-MTPLess.gguf | GGUF | Q4_K_XL | 13.30 GB | Download |
Model Details
Model README
---
library_name: llama.cpp
base_model: WaveCut/Qwen3.6-35B-A3B-REAM-160-ru-agent
tags:
- gguf
- qwen3.6
- moe
- ream
- mtpless
- imatrix
- mixed-precision
---
Qwen3.6-35B-A3B-REAM-160-ru-agent-GGUF-MTPLess
MTPLess GGUF variants of
WaveCut/Qwen3.6-35B-A3B-REAM-160-ru-agent.
These files are derived from the MTP-preserved GGUF release by rewriting each
GGUF without Qwen3.6 MTP/NextN tensors. Existing quantized trunk tensors are
preserved; the repack step does not dequantize or re-quantize them.
Use this repo when model size and VRAM headroom matter more than MTP/speculative
decoding. The MTP-preserved GGUFs remain available in
WaveCut/Qwen3.6-35B-A3B-REAM-160-ru-agent-GGUF.
Expected Files
Files are uploaded only after an upstream llama-cli smoke test passes:
- Standard:
Q1_0-MTPLess,IQ1_S-MTPLess,IQ1_M-MTPLess,
Q2_K-MTPLess, Q2_K_S-MTPLess, IQ2_XXS-MTPLess,
IQ2_XS-MTPLess, IQ2_S-MTPLess, IQ2_M-MTPLess,
Q3_K_S-MTPLess, Q3_K_M-MTPLess, Q3_K_L-MTPLess,
IQ3_XXS-MTPLess, IQ3_XS-MTPLess, IQ3_S-MTPLess,
IQ3_M-MTPLess, Q4_0-MTPLess, Q4_1-MTPLess,
Q4_K_S-MTPLess, Q4_K_M-MTPLess, IQ4_NL-MTPLess,
IQ4_XS-MTPLess, MXFP4_MOE-MTPLess.
- Mixed precision:
WC-Q3_K_XL-MTPLess,WC-Q4_K_XL-MTPLess.
Per-file size and SHA256 are recorded in manifests/gguf-*.json.
Repack Method
The repack script removes:
blk.40.*mtp.*blk..nextn.qwen35moe.nextn_predict_layersqwen35moe.block_count=41, rewritten to40
It also adds the mtpless tag to general.tags when tags are present.
The resulting files are ordinary GGUF model files for normal next-token
generation. They do not contain an embedded MTP draft head.
Validation
Every published file must pass:
llama-gguf-dumpmanifest generation;llama-cliRussian Cyrillic smoke;llama-cliXML tool-call smoke;llama-clicoding-agent smoke.
See RECIPE.md, manifests/, stats/, and logs/ for the full audit trail.
Run BahamutRU/Qwen3.6-35B-A3B-REAM-160-ru-agent-GGUF-MTPLess with guIDE
Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.
Source: Hugging Face · Compare models