GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →
Model Intelligence Sheet

interpolators/FableOpus-9B-Delta-GGUF overview

FableOpus 9B Delta GGUF GGUF quantizations for interpolators/FableOpus 9B Delta https://huggingface.co/interpolators/FableOpus 9B Delta . This repo includes th…

ggufqwen3.5fableopusfableopusquantizedllama.cpptext-generationenlicense:apache-2.0endpoints_compatibleregion:usconversational

Runs locally from ~3.56 GB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).

Downloads
0
Likes
0
Pipeline
text-generation

Repository Files & Downloads

5 GGUF files detected
Direct downloads for local inference
FileTypeQuantizationSizeLink
FableOpus-9B-Delta-Q2_K.ggufGGUFQ2_K3.56 GBDownload
FableOpus-9B-Delta-Q3_K_M.ggufGGUFQ3_K_M4.31 GBDownload
FableOpus-9B-Delta-Q4_K_M.ggufGGUFQ4_K_M5.24 GBDownload
FableOpus-9B-Delta-Q6_K.ggufGGUFQ6_K6.85 GBDownload
FableOpus-9B-Delta-Q8_0.ggufGGUFQ8_08.87 GBDownload

Model Details

Model IDinterpolators/FableOpus-9B-Delta-GGUF
Authorinterpolators
Pipelinetext-generation
Licenseapache-2.0
Base model
Last modified2026-06-21T22:32:26.000Z

Model README

---

language:

  • en

license: apache-2.0

tags:

  • gguf
  • qwen3.5
  • fable
  • opus
  • fableopus
  • quantized
  • llama.cpp

pipeline_tag: text-generation

---

FableOpus-9B-Delta GGUF

GGUF quantizations for interpolators/FableOpus-9B-Delta.

This repo includes the requested llama.cpp quantizations in one place:

  • FableOpus-9B-Delta-Q2_K.gguf (3.56 GiB)
  • FableOpus-9B-Delta-Q3_K_M.gguf (4.31 GiB)
  • FableOpus-9B-Delta-Q4_K_M.gguf (5.24 GiB)
  • FableOpus-9B-Delta-Q6_K.gguf (6.85 GiB)
  • FableOpus-9B-Delta-Q8_0.gguf (8.87 GiB)

Source Model

  • Source: interpolators/FableOpus-9B-Delta
  • Family: Qwen3.5 9B
  • Merge method: delta_linear
  • Merge recipe: Fable 0.38, Opus 0.42, Opus v2 0.20
  • GGUF tooling: latest ggml-org/llama.cpp built in Modal
  • Intermediate: bf16 GGUF, deleted after quantization

Usage

llama-cli -m FableOpus-9B-Delta-Q4_K_M.gguf -p "Write a concise plan for evaluating this model."

Use Q4_K_M as a practical default, Q6_K or Q8_0 for higher quality, and Q2_K / Q3_K_M when size matters most.

Run interpolators/FableOpus-9B-Delta-GGUF with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models

Source: Hugging Face · Compare models