AesSedai/Kimi-K2.7-Code-GGUF overview
Model This is a text and image only GGUF quantization of moonshotai/Kimi K2.7 Code. This means that video input is not present in this GGUF, and will not be av…
Runs locally from ~6.6 MB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).
Repository Files & Downloads
| File | Type | Quantization | Size | Link |
|---|---|---|---|---|
| IQ2_S/Kimi-K2.7-Code-IQ2_S-00001-of-00008.gguf | GGUF | IQ2_S | 6.6 MB | Download |
| IQ2_S/Kimi-K2.7-Code-IQ2_S-00002-of-00008.gguf | GGUF | IQ2_S | 46.52 GB | Download |
| IQ2_S/Kimi-K2.7-Code-IQ2_S-00003-of-00008.gguf | GGUF | IQ2_S | 46.05 GB | Download |
| IQ2_S/Kimi-K2.7-Code-IQ2_S-00004-of-00008.gguf | GGUF | IQ2_S | 46.05 GB | Download |
| IQ2_S/Kimi-K2.7-Code-IQ2_S-00005-of-00008.gguf | GGUF | IQ2_S | 46.38 GB | Download |
| IQ2_S/Kimi-K2.7-Code-IQ2_S-00006-of-00008.gguf | GGUF | IQ2_S | 45.99 GB | Download |
| IQ2_S/Kimi-K2.7-Code-IQ2_S-00007-of-00008.gguf | GGUF | IQ2_S | 46.30 GB | Download |
| IQ2_S/Kimi-K2.7-Code-IQ2_S-00008-of-00008.gguf | GGUF | IQ2_S | 34.51 GB | Download |
| IQ2_XXS/Kimi-K2.7-Code-IQ2_XXS-00001-of-00007.gguf | GGUF | IQ2_XXS | 6.6 MB | Download |
| IQ2_XXS/Kimi-K2.7-Code-IQ2_XXS-00002-of-00007.gguf | GGUF | IQ2_XXS | 46.54 GB | Download |
| IQ2_XXS/Kimi-K2.7-Code-IQ2_XXS-00003-of-00007.gguf | GGUF | IQ2_XXS | 46.36 GB | Download |
| IQ2_XXS/Kimi-K2.7-Code-IQ2_XXS-00004-of-00007.gguf | GGUF | IQ2_XXS | 46.20 GB | Download |
| IQ2_XXS/Kimi-K2.7-Code-IQ2_XXS-00005-of-00007.gguf | GGUF | IQ2_XXS | 46.29 GB | Download |
| IQ2_XXS/Kimi-K2.7-Code-IQ2_XXS-00006-of-00007.gguf | GGUF | IQ2_XXS | 44.66 GB | Download |
| IQ2_XXS/Kimi-K2.7-Code-IQ2_XXS-00007-of-00007.gguf | GGUF | IQ2_XXS | 32.72 GB | Download |
| IQ3_S/Kimi-K2.7-Code-IQ3_S-00001-of-00010.gguf | GGUF | IQ3_S | 6.6 MB | Download |
| IQ3_S/Kimi-K2.7-Code-IQ3_S-00002-of-00010.gguf | GGUF | IQ3_S | 45.03 GB | Download |
| IQ3_S/Kimi-K2.7-Code-IQ3_S-00003-of-00010.gguf | GGUF | IQ3_S | 45.52 GB | Download |
| IQ3_S/Kimi-K2.7-Code-IQ3_S-00004-of-00010.gguf | GGUF | IQ3_S | 45.74 GB | Download |
| IQ3_S/Kimi-K2.7-Code-IQ3_S-00005-of-00010.gguf | GGUF | IQ3_S | 45.68 GB | Download |
| IQ3_S/Kimi-K2.7-Code-IQ3_S-00006-of-00010.gguf | GGUF | IQ3_S | 46.54 GB | Download |
| IQ3_S/Kimi-K2.7-Code-IQ3_S-00007-of-00010.gguf | GGUF | IQ3_S | 44.98 GB | Download |
| IQ3_S/Kimi-K2.7-Code-IQ3_S-00008-of-00010.gguf | GGUF | IQ3_S | 46.54 GB | Download |
| IQ3_S/Kimi-K2.7-Code-IQ3_S-00009-of-00010.gguf | GGUF | IQ3_S | 44.76 GB | Download |
| IQ3_S/Kimi-K2.7-Code-IQ3_S-00010-of-00010.gguf | GGUF | IQ3_S | 12.76 GB | Download |
| Q3_K_L/Kimi-K2.7-Code-Q3_K_L-00001-of-00012.gguf | GGUF | Q3_K_L | 6.6 MB | Download |
| Q3_K_L/Kimi-K2.7-Code-Q3_K_L-00002-of-00012.gguf | GGUF | Q3_K_L | 46.26 GB | Download |
| Q3_K_L/Kimi-K2.7-Code-Q3_K_L-00003-of-00012.gguf | GGUF | Q3_K_L | 45.71 GB | Download |
| Q3_K_L/Kimi-K2.7-Code-Q3_K_L-00004-of-00012.gguf | GGUF | Q3_K_L | 45.71 GB | Download |
| Q3_K_L/Kimi-K2.7-Code-Q3_K_L-00005-of-00012.gguf | GGUF | Q3_K_L | 45.71 GB | Download |
| Q3_K_L/Kimi-K2.7-Code-Q3_K_L-00006-of-00012.gguf | GGUF | Q3_K_L | 45.71 GB | Download |
| Q3_K_L/Kimi-K2.7-Code-Q3_K_L-00007-of-00012.gguf | GGUF | Q3_K_L | 45.71 GB | Download |
| Q3_K_L/Kimi-K2.7-Code-Q3_K_L-00008-of-00012.gguf | GGUF | Q3_K_L | 45.71 GB | Download |
| Q3_K_L/Kimi-K2.7-Code-Q3_K_L-00009-of-00012.gguf | GGUF | Q3_K_L | 45.71 GB | Download |
| Q3_K_L/Kimi-K2.7-Code-Q3_K_L-00010-of-00012.gguf | GGUF | Q3_K_L | 45.71 GB | Download |
| Q3_K_L/Kimi-K2.7-Code-Q3_K_L-00011-of-00012.gguf | GGUF | Q3_K_L | 45.71 GB | Download |
| Q3_K_L/Kimi-K2.7-Code-Q3_K_L-00012-of-00012.gguf | GGUF | Q3_K_L | 2.27 GB | Download |
| Q4_X/Kimi-K2.7-Code-Q4_X-00001-of-00014.gguf | GGUF | Q4_X | 6.6 MB | Download |
| Q4_X/Kimi-K2.7-Code-Q4_X-00002-of-00014.gguf | GGUF | Q4_X | 44.92 GB | Download |
| Q4_X/Kimi-K2.7-Code-Q4_X-00003-of-00014.gguf | GGUF | Q4_X | 45.07 GB | Download |
| Q4_X/Kimi-K2.7-Code-Q4_X-00004-of-00014.gguf | GGUF | Q4_X | 45.07 GB | Download |
| Q4_X/Kimi-K2.7-Code-Q4_X-00005-of-00014.gguf | GGUF | Q4_X | 45.07 GB | Download |
| Q4_X/Kimi-K2.7-Code-Q4_X-00006-of-00014.gguf | GGUF | Q4_X | 45.07 GB | Download |
| Q4_X/Kimi-K2.7-Code-Q4_X-00007-of-00014.gguf | GGUF | Q4_X | 45.07 GB | Download |
| Q4_X/Kimi-K2.7-Code-Q4_X-00008-of-00014.gguf | GGUF | Q4_X | 45.07 GB | Download |
| Q4_X/Kimi-K2.7-Code-Q4_X-00009-of-00014.gguf | GGUF | Q4_X | 45.07 GB | Download |
| Q4_X/Kimi-K2.7-Code-Q4_X-00010-of-00014.gguf | GGUF | Q4_X | 45.07 GB | Download |
| Q4_X/Kimi-K2.7-Code-Q4_X-00011-of-00014.gguf | GGUF | Q4_X | 45.07 GB | Download |
| Q4_X/Kimi-K2.7-Code-Q4_X-00012-of-00014.gguf | GGUF | Q4_X | 45.07 GB | Download |
| Q4_X/Kimi-K2.7-Code-Q4_X-00013-of-00014.gguf | GGUF | Q4_X | 45.07 GB | Download |
| Q4_X/Kimi-K2.7-Code-Q4_X-00014-of-00014.gguf | GGUF | Q4_X | 2.97 GB | Download |
| imatrix.gguf | GGUF | GGUF | 1.43 GB | Download |
| mmproj-Kimi-K2.7-Code-BF16.gguf | GGUF | BF16 | 909.7 MB | Download |
| mmproj-Kimi-K2.7-Code-F16.gguf | GGUF | F16 | 908.4 MB | Download |
| mmproj-Kimi-K2.7-Code-F32.gguf | GGUF | F32 | 1.76 GB | Download |
| mmproj-Kimi-K2.7-Code-Q8_0.gguf | GGUF | Q8_0 | 613.4 MB | Download |
Model Details
Model README
---
base_model:
- moonshotai/Kimi-K2.7-Code
---
Model
This is a text-and-image-only GGUF quantization of moonshotai/Kimi-K2.7-Code. This means that video input is not present in this GGUF, and will not be available until support is added upstream in llama.cpp. MMPROJ files for image vision input have been provided.
This Q4_X quant is the "full quality" equivalent since the conditional experts are natively INT4 quantized directly from the original model, and the rest of the model is Q8_0.
| Quant | Size | Mixture | PPL | 1-(Mean PPL(Q)/PPL(base)) | KLD |
| :----- | :--------------------- | :------------------------ | :------------------ | :------------------------ | :------------------ |
| Q4_X | 543.62 GiB (4.55 BPW) | Q8_0 / Q4_0 / Q4_0 / Q4_0 | 2.009155 ± 0.008931 | +0% | 0 |
| Q3_K_L | 459.94 GiB (3.85 BPW) | Q8_0 / Q3_K / Q3_K / Q4_0 | 2.085207 ± 0.009398 | +3.9167% | 0.063007 ± 0.000544 |
| IQ3_S | 377.54 GiB (3.16 BPW) | Q8_0 / varies | 2.310321 ± 0.010823 | +15.1353% | 0.178673 ± 0.001326 |
| IQ2_S | 311.80 GiB (2.61 BPW) | Q8_0 / varies | 2.690751 ± 0.013248 | +34.0941% | 0.343187 ± 0.002100 |
| IQ2_XXS | 262.78 GiB (2.20 BPW) | Q8_0 / varies | 3.420305 ± 0.018189 | +70.4515% | 0.587342 ± 0.002980 |
The mixtures with varies in them were produced by @eaddario 's llama.cpp branches for imatrix and quantize respectively:
- imatrix: https://github.com/ggml-org/llama.cpp/pull/14891
- quantize: https://github.com/ggml-org/llama.cpp/pull/15550
Run AesSedai/Kimi-K2.7-Code-GGUF with guIDE
Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.
Source: Hugging Face · Compare models