GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →
Model Intelligence Sheet

BahamutRU/Qwen3.6-35B-A3B-REAM-160-ru-agent-GGUF-MTPLess overview

Qwen3.6 35B A3B REAM 160 ru agent GGUF MTPLess MTPLess GGUF variants of WaveCut/Qwen3.6 35B A3B REAM 160 ru agent https://huggingface.co/WaveCut/Qwen3.6 35B A3…

llama.cppggufqwen3.6moereammtplessimatrixmixed-precisionbase_model:WaveCut/Qwen3.6-35B-A3B-REAM-160-ru-agentbase_model:quantized:WaveCut/Qwen3.6-35B-A3B-REAM-160-ru-agentregion:us

Runs locally from ~3.34 GB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).

Downloads
0
Likes
0
Pipeline
Author

Repository Files & Downloads

25 GGUF files detected
Direct downloads for local inference
FileTypeQuantizationSizeLink
Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ1_M-MTPLess.ggufGGUFIQ1_M5.15 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ1_S-MTPLess.ggufGGUFIQ1_S4.71 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ2_M-MTPLess.ggufGGUFIQ2_M7.19 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ2_S-MTPLess.ggufGGUFIQ2_S6.60 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ2_XS-MTPLess.ggufGGUFIQ2_XS6.49 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ2_XXS-MTPLess.ggufGGUFIQ2_XXS5.90 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ3_M-MTPLess.ggufGGUFIQ3_M9.45 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ3_S-MTPLess.ggufGGUFIQ3_S9.34 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ3_XS-MTPLess.ggufGGUFIQ3_XS8.89 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ3_XXS-MTPLess.ggufGGUFIQ3_XXS8.35 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ4_NL-MTPLess.ggufGGUFIQ4_NL12.06 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-IQ4_XS-MTPLess.ggufGGUFIQ4_XS11.44 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-MXFP4_MOE-MTPLess.ggufGGUFGGUF12.43 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-Q1_0-MTPLess.ggufGGUFQ1_03.34 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-Q2_K-MTPLess.ggufGGUFQ2_K7.95 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-Q2_K_S-MTPLess.ggufGGUFQ2_K_S7.49 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-Q3_K_L-MTPLess.ggufGGUFQ3_K_L11.04 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-Q3_K_M-MTPLess.ggufGGUFQ3_K_M10.23 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-Q3_K_S-MTPLess.ggufGGUFQ3_K_S9.28 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-Q4_0-MTPLess.ggufGGUFQ4_012.05 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-Q4_1-MTPLess.ggufGGUFQ4_113.29 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-Q4_K_M-MTPLess.ggufGGUFQ4_K_M12.87 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-Q4_K_S-MTPLess.ggufGGUFQ4_K_S12.11 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-WC-Q3_K_XL-MTPLess.ggufGGUFQ3_K_XL10.75 GBDownload
Qwen3.6-35B-A3B-REAM-160-ru-agent-WC-Q4_K_XL-MTPLess.ggufGGUFQ4_K_XL13.30 GBDownload

Model Details

Model IDBahamutRU/Qwen3.6-35B-A3B-REAM-160-ru-agent-GGUF-MTPLess
AuthorBahamutRU
Pipeline
License
Base modelWaveCut/Qwen3.6-35B-A3B-REAM-160-ru-agent
Last modified2026-06-23T09:48:34.000Z

Model README

---

library_name: llama.cpp

base_model: WaveCut/Qwen3.6-35B-A3B-REAM-160-ru-agent

tags:

- gguf

- qwen3.6

- moe

- ream

- mtpless

- imatrix

- mixed-precision

---

Qwen3.6-35B-A3B-REAM-160-ru-agent-GGUF-MTPLess

MTPLess GGUF variants of

WaveCut/Qwen3.6-35B-A3B-REAM-160-ru-agent.

These files are derived from the MTP-preserved GGUF release by rewriting each

GGUF without Qwen3.6 MTP/NextN tensors. Existing quantized trunk tensors are

preserved; the repack step does not dequantize or re-quantize them.

Use this repo when model size and VRAM headroom matter more than MTP/speculative

decoding. The MTP-preserved GGUFs remain available in

WaveCut/Qwen3.6-35B-A3B-REAM-160-ru-agent-GGUF.

Expected Files

Files are uploaded only after an upstream llama-cli smoke test passes:

  • Standard: Q1_0-MTPLess, IQ1_S-MTPLess, IQ1_M-MTPLess,

Q2_K-MTPLess, Q2_K_S-MTPLess, IQ2_XXS-MTPLess,

IQ2_XS-MTPLess, IQ2_S-MTPLess, IQ2_M-MTPLess,

Q3_K_S-MTPLess, Q3_K_M-MTPLess, Q3_K_L-MTPLess,

IQ3_XXS-MTPLess, IQ3_XS-MTPLess, IQ3_S-MTPLess,

IQ3_M-MTPLess, Q4_0-MTPLess, Q4_1-MTPLess,

Q4_K_S-MTPLess, Q4_K_M-MTPLess, IQ4_NL-MTPLess,

IQ4_XS-MTPLess, MXFP4_MOE-MTPLess.

  • Mixed precision: WC-Q3_K_XL-MTPLess, WC-Q4_K_XL-MTPLess.

Per-file size and SHA256 are recorded in manifests/gguf-*.json.

Repack Method

The repack script removes:

  • blk.40.*
  • mtp.*
  • blk..nextn.
  • qwen35moe.nextn_predict_layers
  • qwen35moe.block_count=41, rewritten to 40

It also adds the mtpless tag to general.tags when tags are present.

The resulting files are ordinary GGUF model files for normal next-token

generation. They do not contain an embedded MTP draft head.

Validation

Every published file must pass:

  • llama-gguf-dump manifest generation;
  • llama-cli Russian Cyrillic smoke;
  • llama-cli XML tool-call smoke;
  • llama-cli coding-agent smoke.

See RECIPE.md, manifests/, stats/, and logs/ for the full audit trail.

Run BahamutRU/Qwen3.6-35B-A3B-REAM-160-ru-agent-GGUF-MTPLess with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models

Source: Hugging Face · Compare models