0ppxnhximxr/GLM-5.3-Flash-GGUF overview
GLM 5.3 Flash GGUF GGUF quantizations of zai org/GLM 5.3 Flash BF16 https://huggingface.co/zai org/GLM 5.3 Flash BF16 , converted directly from the official BF…
Runs locally from ~4.83 GB disk (8 GB VRAM class GPUs with llama.cpp / guIDE).
Repository Files & Downloads
| File | Type | Quantization | Size | Link |
|---|---|---|---|---|
| IQ2_XS/GLM-5.3-Flash-IQ2_XS-00001-of-00016.gguf | GGUF | IQ2_XS | 5.65 GB | Download |
| IQ2_XS/GLM-5.3-Flash-IQ2_XS-00002-of-00016.gguf | GGUF | IQ2_XS | 5.40 GB | Download |
| IQ2_XS/GLM-5.3-Flash-IQ2_XS-00003-of-00016.gguf | GGUF | IQ2_XS | 5.33 GB | Download |
| IQ2_XS/GLM-5.3-Flash-IQ2_XS-00004-of-00016.gguf | GGUF | IQ2_XS | 4.83 GB | Download |
| IQ2_XS/GLM-5.3-Flash-IQ2_XS-00005-of-00016.gguf | GGUF | IQ2_XS | 5.33 GB | Download |
| IQ2_XS/GLM-5.3-Flash-IQ2_XS-00006-of-00016.gguf | GGUF | IQ2_XS | 5.39 GB | Download |
| IQ2_XS/GLM-5.3-Flash-IQ2_XS-00007-of-00016.gguf | GGUF | IQ2_XS | 5.39 GB | Download |
| IQ2_XS/GLM-5.3-Flash-IQ2_XS-00008-of-00016.gguf | GGUF | IQ2_XS | 5.33 GB | Download |
| IQ2_XS/GLM-5.3-Flash-IQ2_XS-00009-of-00016.gguf | GGUF | IQ2_XS | 5.38 GB | Download |
| IQ2_XS/GLM-5.3-Flash-IQ2_XS-00010-of-00016.gguf | GGUF | IQ2_XS | 5.40 GB | Download |
| IQ2_XS/GLM-5.3-Flash-IQ2_XS-00011-of-00016.gguf | GGUF | IQ2_XS | 5.33 GB | Download |
| IQ2_XS/GLM-5.3-Flash-IQ2_XS-00012-of-00016.gguf | GGUF | IQ2_XS | 5.39 GB | Download |
| IQ2_XS/GLM-5.3-Flash-IQ2_XS-00013-of-00016.gguf | GGUF | IQ2_XS | 5.40 GB | Download |
| IQ2_XS/GLM-5.3-Flash-IQ2_XS-00014-of-00016.gguf | GGUF | IQ2_XS | 5.33 GB | Download |
| IQ2_XS/GLM-5.3-Flash-IQ2_XS-00015-of-00016.gguf | GGUF | IQ2_XS | 5.40 GB | Download |
| IQ2_XS/GLM-5.3-Flash-IQ2_XS-00016-of-00016.gguf | GGUF | IQ2_XS | 5.39 GB | Download |
| IQ3_XXS/GLM-5.3-Flash-IQ3_XXS-00001-of-00016.gguf | GGUF | IQ3_XXS | 7.06 GB | Download |
| IQ3_XXS/GLM-5.3-Flash-IQ3_XXS-00002-of-00016.gguf | GGUF | IQ3_XXS | 7.09 GB | Download |
| IQ3_XXS/GLM-5.3-Flash-IQ3_XXS-00003-of-00016.gguf | GGUF | IQ3_XXS | 7.03 GB | Download |
| IQ3_XXS/GLM-5.3-Flash-IQ3_XXS-00004-of-00016.gguf | GGUF | IQ3_XXS | 6.34 GB | Download |
| IQ3_XXS/GLM-5.3-Flash-IQ3_XXS-00005-of-00016.gguf | GGUF | IQ3_XXS | 7.02 GB | Download |
| IQ3_XXS/GLM-5.3-Flash-IQ3_XXS-00006-of-00016.gguf | GGUF | IQ3_XXS | 7.10 GB | Download |
| IQ3_XXS/GLM-5.3-Flash-IQ3_XXS-00007-of-00016.gguf | GGUF | IQ3_XXS | 7.10 GB | Download |
| IQ3_XXS/GLM-5.3-Flash-IQ3_XXS-00008-of-00016.gguf | GGUF | IQ3_XXS | 7.02 GB | Download |
| IQ3_XXS/GLM-5.3-Flash-IQ3_XXS-00009-of-00016.gguf | GGUF | IQ3_XXS | 7.11 GB | Download |
| IQ3_XXS/GLM-5.3-Flash-IQ3_XXS-00010-of-00016.gguf | GGUF | IQ3_XXS | 7.09 GB | Download |
| IQ3_XXS/GLM-5.3-Flash-IQ3_XXS-00011-of-00016.gguf | GGUF | IQ3_XXS | 7.03 GB | Download |
| IQ3_XXS/GLM-5.3-Flash-IQ3_XXS-00012-of-00016.gguf | GGUF | IQ3_XXS | 7.10 GB | Download |
| IQ3_XXS/GLM-5.3-Flash-IQ3_XXS-00013-of-00016.gguf | GGUF | IQ3_XXS | 7.09 GB | Download |
| IQ3_XXS/GLM-5.3-Flash-IQ3_XXS-00014-of-00016.gguf | GGUF | IQ3_XXS | 7.03 GB | Download |
| IQ3_XXS/GLM-5.3-Flash-IQ3_XXS-00015-of-00016.gguf | GGUF | IQ3_XXS | 7.09 GB | Download |
| IQ3_XXS/GLM-5.3-Flash-IQ3_XXS-00016-of-00016.gguf | GGUF | IQ3_XXS | 7.10 GB | Download |
| Q4_K_M/GLM-5.3-Flash-Q4_K_M-00001-of-00016.gguf | GGUF | Q4_K_M | 10.82 GB | Download |
| Q4_K_M/GLM-5.3-Flash-Q4_K_M-00002-of-00016.gguf | GGUF | Q4_K_M | 11.00 GB | Download |
| Q4_K_M/GLM-5.3-Flash-Q4_K_M-00003-of-00016.gguf | GGUF | Q4_K_M | 10.91 GB | Download |
| Q4_K_M/GLM-5.3-Flash-Q4_K_M-00004-of-00016.gguf | GGUF | Q4_K_M | 9.91 GB | Download |
| Q4_K_M/GLM-5.3-Flash-Q4_K_M-00005-of-00016.gguf | GGUF | Q4_K_M | 10.90 GB | Download |
| Q4_K_M/GLM-5.3-Flash-Q4_K_M-00006-of-00016.gguf | GGUF | Q4_K_M | 11.00 GB | Download |
| Q4_K_M/GLM-5.3-Flash-Q4_K_M-00007-of-00016.gguf | GGUF | Q4_K_M | 10.42 GB | Download |
| Q4_K_M/GLM-5.3-Flash-Q4_K_M-00008-of-00016.gguf | GGUF | Q4_K_M | 11.48 GB | Download |
| Q4_K_M/GLM-5.3-Flash-Q4_K_M-00009-of-00016.gguf | GGUF | Q4_K_M | 11.00 GB | Download |
| Q4_K_M/GLM-5.3-Flash-Q4_K_M-00010-of-00016.gguf | GGUF | Q4_K_M | 11.00 GB | Download |
| Q4_K_M/GLM-5.3-Flash-Q4_K_M-00011-of-00016.gguf | GGUF | Q4_K_M | 10.90 GB | Download |
| Q4_K_M/GLM-5.3-Flash-Q4_K_M-00012-of-00016.gguf | GGUF | Q4_K_M | 11.58 GB | Download |
| Q4_K_M/GLM-5.3-Flash-Q4_K_M-00013-of-00016.gguf | GGUF | Q4_K_M | 11.59 GB | Download |
| Q4_K_M/GLM-5.3-Flash-Q4_K_M-00014-of-00016.gguf | GGUF | Q4_K_M | 12.06 GB | Download |
| Q4_K_M/GLM-5.3-Flash-Q4_K_M-00015-of-00016.gguf | GGUF | Q4_K_M | 11.02 GB | Download |
| Q4_K_M/GLM-5.3-Flash-Q4_K_M-00016-of-00016.gguf | GGUF | Q4_K_M | 10.43 GB | Download |
Model Details
| Model ID | 0ppxnhximxr/GLM-5.3-Flash-GGUF |
|---|---|
| Author | 0ppxnhximxr |
| Pipeline | text-generation |
| License | mit |
| Base model | zai-org/GLM-5.3-Flash-BF16 |
| Last modified | 2026-08-28T17:58:18.000Z |
Model README
---
base_model: zai-org/GLM-5.3-Flash-BF16
base_model_relation: quantized
library_name: gguf
license: mit
pipeline_tag: text-generation
language:
- en
- zh
tags:
- gguf
- llama.cpp
- glm5_next
- imatrix
---
GLM-5.3-Flash GGUF
GGUF quantizations of zai-org/GLM-5.3-Flash-BF16, converted directly from the official BF16 weights.
Quantizations
| Quantization | Notes |
|---|---|
| Q4_K_M | Recommended quality/size balance; importance-matrix calibrated |
| IQ3_XXS | Mid-size 3.08 BPW build; importance-matrix calibrated |
| IQ2_XS | Compact 2.35 BPW build; importance-matrix calibrated |
The GLM-5.3-sensitive router, shared-expert, mHC, and linear-attention state tensors are preserved at higher precision by the GLM-5.3 llama.cpp quantization rules. The unsupported NextN/MTP draft head is excluded.
Usage
Use a recent GLM-5.3-compatible llama.cpp build and point to the first shard:
llama-cli -m Q4_K_M/GLM-5.3-Flash-Q4_K_M-00001-of-00016.gguf
All shards in the selected quantization directory are required.
License
MIT, inherited from the original model.
Run 0ppxnhximxr/GLM-5.3-Flash-GGUF with guIDE
Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.
Source: Hugging Face · Compare models