GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →
Model Intelligence Sheet

fzcfweasdferttgg/Ling-3.0-flash-abliterated-GGUF overview

Ling 3.0 flash abliterated — GGUF Quants Standard static quants no imatrix + APEX mixed precision quants of SC117's abliterix v6 trial 21 merge. Original model…

ggufmoehybridreasoningabliteratedquantizationbailingmoe3inclusionAItext-generationbase_model:SC117/Ling-3.0-flash-abliterated-APEX-GGUFbase_model:quantized:SC117/Ling-3.0-flash-abliterated-APEX-GGUFlicense:mitendpoints_compatibleregion:usconversational

Runs locally from ~43.34 GB disk (32 GB+ VRAM class GPUs with llama.cpp / guIDE).

Downloads
0
Likes
0
Pipeline
text-generation

Repository Files & Downloads

11 GGUF files detected
Direct downloads for local inference
FileTypeQuantizationSizeLink
Ling-3.0-flash-abliterated-APEX-Balanced.ggufGGUFGGUF85.99 GBDownload
Ling-3.0-flash-abliterated-APEX-Compact.ggufGGUFGGUF56.23 GBDownload
Ling-3.0-flash-abliterated-APEX-Quality.ggufGGUFGGUF75.88 GBDownload
Ling-3.0-flash-abliterated-Q2_K.ggufGGUFQ2_K43.34 GBDownload
Ling-3.0-flash-abliterated-Q3_K_L.ggufGGUFQ3_K_L61.49 GBDownload
Ling-3.0-flash-abliterated-Q3_K_M.ggufGGUFQ3_K_M56.58 GBDownload
Ling-3.0-flash-abliterated-Q3_K_S.ggufGGUFQ3_K_S51.36 GBDownload
Ling-3.0-flash-abliterated-Q4_K_M.ggufGGUFQ4_K_M71.72 GBDownload
Ling-3.0-flash-abliterated-Q5_K_M.ggufGGUFQ5_K_M84.25 GBDownload
Ling-3.0-flash-abliterated-Q6_K.ggufGGUFQ6_K97.57 GBDownload
Ling-3.0-flash-abliterated-Q8_0.ggufGGUFQ8_0126.31 GBDownload

Model Details

Model IDfzcfweasdferttgg/Ling-3.0-flash-abliterated-GGUF
Authorfzcfweasdferttgg
Pipelinetext-generation
Licensemit
Base modelinclusionAI/Ling-3.0-flash,SC117/Ling-3.0-flash-abliterated-APEX-GGUF
Last modified2026-08-18T06:28:17.000Z

Model README

---

library_name: gguf

license: mit

pipeline_tag: text-generation

tags:

  • gguf
  • moe
  • hybrid
  • reasoning
  • abliterated
  • quantization
  • bailingmoe3
  • inclusionAI

base_model:

  • inclusionAI/Ling-3.0-flash
  • SC117/Ling-3.0-flash-abliterated-APEX-GGUF

base_model_relation: quantized

---

Ling-3.0-flash-abliterated — GGUF Quants

Standard static quants (no imatrix) + APEX mixed-precision quants of SC117's abliterix v6 trial 21 merge.

Original model: SC117/Ling-3.0-flash-abliterated-APEX-GGUF

Base model: inclusionAI/Ling-3.0-flash

Abliteration by: abliterix v6 trial 21

Architecture: bailingmoe3 (124B total, 5.1B active)

License: MIT

Files

Standard Static Quants (llama-quantize, no imatrix)

| File | Type | Approx Size |

|---|---|---|

| *-Q2_K.gguf | Q2_K | ~40 GB |

| *-Q3_K_S.gguf | Q3_K_S | ~50 GB |

| *-Q3_K_M.gguf | Q3_K_M | ~55 GB |

| *-Q3_K_L.gguf | Q3_K_L | ~60 GB |

| *-Q4_K_M.gguf | Q4_K_M | ~70 GB |

| *-Q5_K_M.gguf | Q5_K_M | ~90 GB |

| *-Q6_K.gguf | Q6_K | ~108 GB |

| *-Q8_0.gguf | Q8_0 | ~140 GB |

APEX Mixed-Precision Quants

| File | Base | Experts | Shared | Attn |

|---|---|---|---|---|

| *-APEX-Quality.gguf | Q6_K | edge Q6_K / mid iq4_xs | Q8_0 | Q6_K |

| *-APEX-Balanced.gguf | Q6_K | edge Q6_K / mid Q5_K | Q8_0 | Q6_K |

| *-APEX-Compact.gguf | Q4_K_M | edge Q4_K / mid Q3_K | Q6_K | Q4_K |

All APEX configs: routers Q8_0, MTP (blk.42) Q8_0. No imatrix required.

APEX Mini (iq2_s mid) excluded — requires imatrix for quantization.

Usage

Requires llama.cpp with PR #26608 (bailingmoe3 support, merged b10472+).

llama-server -m <file>.gguf --flash-attn on --fit on --ctx-size 32768 --reasoning off --jinja

Sampling: temperature 0.6, top_p 0.95, top_k 20

Credits

Run fzcfweasdferttgg/Ling-3.0-flash-abliterated-GGUF with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models

Source: Hugging Face · Compare models