AMAImedia/K2-Horizon-7B-GGUF overview
K2 Horizon 7B — GGUF Quantizations GGUF quantizations of IFM/K2 Horizon 7B https://huggingface.co/IFM/K2 Horizon 7B , a dense 7B parameter causal decoder K2Hor…
Runs locally from ~1.84 GB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).
Repository Files & Downloads
| File | Type | Quantization | Size | Link |
|---|---|---|---|---|
| K2-Horizon-7B-BF16.gguf | GGUF | BF16 | 16.77 GB | Download |
| K2-Horizon-7B-IQ1_M.gguf | GGUF | IQ1_M | 2.49 GB | Download |
| K2-Horizon-7B-IQ1_S.gguf | GGUF | IQ1_S | 2.36 GB | Download |
| K2-Horizon-7B-IQ2_M.gguf | GGUF | IQ2_M | 3.27 GB | Download |
| K2-Horizon-7B-IQ2_S.gguf | GGUF | IQ2_S | 3.09 GB | Download |
| K2-Horizon-7B-IQ2_XS.gguf | GGUF | IQ2_XS | 2.90 GB | Download |
| K2-Horizon-7B-IQ2_XXS.gguf | GGUF | IQ2_XXS | 2.71 GB | Download |
| K2-Horizon-7B-IQ3_M.gguf | GGUF | IQ3_M | 4.10 GB | Download |
| K2-Horizon-7B-IQ3_S.gguf | GGUF | IQ3_S | 4.01 GB | Download |
| K2-Horizon-7B-IQ3_XS.gguf | GGUF | IQ3_XS | 3.85 GB | Download |
| K2-Horizon-7B-IQ3_XXS.gguf | GGUF | IQ3_XXS | 3.56 GB | Download |
| K2-Horizon-7B-IQ4_NL.gguf | GGUF | IQ4_NL | 4.99 GB | Download |
| K2-Horizon-7B-IQ4_XS.gguf | GGUF | IQ4_XS | 4.76 GB | Download |
| K2-Horizon-7B-Q1_0.gguf | GGUF | Q1_0 | 1.84 GB | Download |
| K2-Horizon-7B-Q2_0.gguf | GGUF | Q2_0 | 3.15 GB | Download |
| K2-Horizon-7B-Q2_K.gguf | GGUF | Q2_K | 3.49 GB | Download |
| K2-Horizon-7B-Q2_K_S.gguf | GGUF | Q2_K_S | 3.31 GB | Download |
| K2-Horizon-7B-Q3_K_L.gguf | GGUF | Q3_K_L | 4.60 GB | Download |
| K2-Horizon-7B-Q3_K_M.gguf | GGUF | Q3_K_M | 4.32 GB | Download |
| K2-Horizon-7B-Q3_K_S.gguf | GGUF | Q3_K_S | 3.99 GB | Download |
| K2-Horizon-7B-Q4_0.gguf | GGUF | Q4_0 | 4.97 GB | Download |
| K2-Horizon-7B-Q4_1.gguf | GGUF | Q4_1 | 5.44 GB | Download |
| K2-Horizon-7B-Q4_K_M.gguf | GGUF | Q4_K_M | 5.21 GB | Download |
| K2-Horizon-7B-Q4_K_S.gguf | GGUF | Q4_K_S | 5.00 GB | Download |
| K2-Horizon-7B-Q5_0.gguf | GGUF | Q5_0 | 5.90 GB | Download |
| K2-Horizon-7B-Q5_1.gguf | GGUF | Q5_1 | 6.36 GB | Download |
| K2-Horizon-7B-Q5_K_M.gguf | GGUF | Q5_K_M | 6.02 GB | Download |
| K2-Horizon-7B-Q5_K_S.gguf | GGUF | Q5_K_S | 5.90 GB | Download |
| K2-Horizon-7B-Q6_K.gguf | GGUF | Q6_K | 6.89 GB | Download |
| K2-Horizon-7B-Q8_0.gguf | GGUF | Q8_0 | 8.92 GB | Download |
Model Details
| Model ID | AMAImedia/K2-Horizon-7B-GGUF |
|---|---|
| Author | AMAImedia |
| Pipeline | text-generation |
| License | apache-2.0 |
| Base model | IFM/K2-Horizon-7B |
| Last modified | 2026-09-10T10:39:05.000Z |
Model README
---
base_model: IFM/K2-Horizon-7B
language:
- en
license: apache-2.0
tags:
- gguf
- quantized
- llama.cpp
- k2-horizon
- causal-lm
- text-generation
pipeline_tag: text-generation
---
K2-Horizon-7B — GGUF Quantizations
GGUF quantizations of IFM/K2-Horizon-7B,
a dense 7B-parameter causal decoder (K2HorizonForCausalLM, model_type: k2_horizon).
Quantized by NANI-Nithin using a custom pipeline built on the
MBZUAI-IFM llama.cpp fork (branch model/K2Horizon).
---
Model Details
| Property | Value |
|---|---|
| Base model | IFM/K2-Horizon-7B |
| Architecture | K2HorizonForCausalLM (k2_horizon) |
| Parameters | ~7B (dense decoder, no MoE) |
| Original dtype | BF16 |
| BF16 GGUF size | ~18.01 GB |
| Source GGUF | IFM/K2-Horizon-7B-GGUF |
| llama.cpp fork | MBZUAI-IFM/llama.cpp @ model/K2Horizon |
> Note: These GGUFs carry the k2-horizon architecture token and require
> the MBZUAI-IFM fork (or upstream llama.cpp once support is merged) to run.
> Vanilla upstream llama.cpp (as of September 2026) does not support
> K2HorizonForCausalLM.
---
Included Files
Standard Quantizations
| File | Bits/Weight | Notes |
|---|---|---|
| K2-Horizon-7B-BF16.gguf | 16 bpw | Source quant, full precision |
| K2-Horizon-7B-Q8_0.gguf | 8 bpw | Near-lossless, recommended reference |
| K2-Horizon-7B-Q6_K.gguf | 6 bpw | Near-lossless K-quant |
| K2-Horizon-7B-Q5_K_M.gguf | 5 bpw | Best quality/size in the 5-bit range |
| K2-Horizon-7B-Q5_K_S.gguf | 5 bpw | Smaller 5-bit variant |
| K2-Horizon-7B-Q5_1.gguf | 5 bpw | Legacy 5-bit |
| K2-Horizon-7B-Q5_0.gguf | 5 bpw | Legacy 5-bit |
| K2-Horizon-7B-Q4_K_M.gguf | 4 bpw | Recommended general use |
| K2-Horizon-7B-Q4_K_S.gguf | 4 bpw | Smaller 4-bit K-quant |
| K2-Horizon-7B-Q4_1.gguf | 4 bpw | Legacy 4-bit |
| K2-Horizon-7B-Q4_0.gguf | 4 bpw | Legacy 4-bit |
| K2-Horizon-7B-Q3_K_L.gguf | 3 bpw | Large 3-bit K-quant |
| K2-Horizon-7B-Q3_K_M.gguf | 3 bpw | Medium 3-bit K-quant |
| K2-Horizon-7B-Q3_K_S.gguf | 3 bpw | Small 3-bit K-quant |
| K2-Horizon-7B-Q2_K.gguf | 2 bpw | Aggressive compression |
| K2-Horizon-7B-Q2_K_S.gguf | 2 bpw | Smaller 2-bit K-quant (imatrix-guided) |
| K2-Horizon-7B-Q2_0.gguf | 2.25 bpw | Group-64 2-bit |
| K2-Horizon-7B-Q1_0.gguf | 1.125 bpw | Maximum compression |
IQ (Importance-Matrix) Quantizations
| File | Bits/Weight |
|---|---|
| K2-Horizon-7B-IQ4_NL.gguf | ~4 bpw |
| K2-Horizon-7B-IQ4_XS.gguf | ~4 bpw |
| K2-Horizon-7B-IQ3_M.gguf | ~3 bpw |
| K2-Horizon-7B-IQ3_S.gguf | ~3 bpw |
| K2-Horizon-7B-IQ3_XS.gguf | ~3 bpw |
| K2-Horizon-7B-IQ3_XXS.gguf | ~3 bpw |
| K2-Horizon-7B-IQ2_M.gguf | ~2 bpw |
| K2-Horizon-7B-IQ2_S.gguf | ~2 bpw |
| K2-Horizon-7B-IQ2_XS.gguf | ~2 bpw |
| K2-Horizon-7B-IQ2_XXS.gguf | ~2 bpw |
| K2-Horizon-7B-IQ1_M.gguf | 1.75 bpw |
| K2-Horizon-7B-IQ1_S.gguf | 1.56 bpw |
---
Quantization Method
- Source: IFM's official BF16 GGUF (
K2-Horizon-7B-BF16.gguf). - imatrix: Computed from Salesforce/wikitext
(wikitext-2-raw-v1, 500 rows) with 12 GPU layers offloaded on an RTX 4060 Laptop (8 GB VRAM)
due to the 18 GB model size. Applied to all K-quants below Q6 and all IQ quants.
- Fork: MBZUAI-IFM/llama.cpp, branch
model/K2Horizon.
---
Usage
> Requires the MBZUAI-IFM llama.cpp fork (model/K2Horizon branch).
git clone -b model/K2Horizon https://github.com/MBZUAI-IFM/llama.cpp
cd llama.cpp && cmake -B build -DGGML_CUDA=ON && cmake --build build --config Release
./build/bin/llama-cli \
-m K2-Horizon-7B-Q4_K_M.gguf \
-p "Hello, I am" \
-n 128 \
-ngl 35
---
License
Weights are released under the same license as the original
IFM/K2-Horizon-7B model.
Please refer to the original repository for full license terms.
---
Credits
- Original model: MBZUAI IFM
- Quantized by: NANI-Nithin
- Quantization tool: MBZUAI-IFM/llama.cpp
Run AMAImedia/K2-Horizon-7B-GGUF with guIDE
Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.
Source: Hugging Face · Compare models