GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →
Model Intelligence Sheet

Brunobkr/OFFFELLIA_Muse-Glimmer-30B-Heretic.gguf overview

ΩFFFΣLLIa • llama.cpp • OFFFELLIA HERETIC <div align="center" <img src="./capa.png" alt="OFFFELLIA HERETIC Banner" width="100%" style="border radius: 12px; mar…

ggufdoi:10.57967/hf/10590region:us

Runs locally from ~9.95 GB disk (12 GB VRAM class GPUs with llama.cpp / guIDE).

Downloads
0
Likes
0
Pipeline
—
Author

Repository Files & Downloads

3 GGUF files detected
Direct downloads for local inference
FileTypeQuantizationSizeLink
ΩFFFΣLLIα_F16_Muse-Glimmer-30B-Heretic.ggufGGUFF1651.90 GBDownload
ΩFFFΣLLIα_IQ4_NL_Muse-Glimmer-30B-Heretic.ggufGGUFIQ4_NL_MUSE15.04 GBDownload
ΩFFFΣLLIα_Q2_K_3.07_BPW_Muse-Glimmer-30B-Heretic.ggufGGUFQ2_K_39.95 GBDownload

Model Details

Model IDBrunobkr/OFFFELLIA_Muse-Glimmer-30B-Heretic.gguf
AuthorBrunobkr
Pipeline—
License—
Base model—
Last modified2026-09-25T02:02:59.000Z

Model README

ΩFFFΣLLIa • llama.cpp • OFFFELLIA_HERETIC

<div align="center">

<img src="./capa.png" alt="OFFFELLIA_HERETIC Banner" width="100%" style="border-radius: 12px; margin-bottom: 15px; box-shadow: 0 4px 20px rgba(0, 102, 153, 0.3);" />

<p align="center">

<img src="./pix.jpeg" alt="OFFFELLIA_HERETIC Web UI -" width="100%" style="border-radius: 8px; margin-bottom: 15px; box-shadow: 0 4px 15px rgba(51, 255, 102, 0.15);" />

   ██████╗ ███████╗███████╗███████╗██╗     ██╗     ██╗ █████╗ 
  ██╔═══██╗██╔════╝██╔════╝██╔════╝██║     ██║     ██║██╔══██╗
  ██║   ██║█████╗  █████╗  █████╗  ██║     ██║     ██║███████║
  ██║   ██║██╔══╝  ██╔══╝  ██╔══╝  ██║     ██║     ██║██╔══██║
  ╚██████╔╝██║     ██║     ███████╗███████╗███████╗██║██║  ██║-HERETIC
   ╚═════╝ ╚═╝     ╚═╝     ╚══════╝╚══════╝╚══════╝╚═╝╚═╝  ╚═╝

<b>High-Performance LLM / VLM Inference & Autonomous Agentic Ecosystem in Pure C/C++</b>

![License: MIT](https://opensource.org/licenses/MIT)

![C++: 17/20](https://en.cppreference.com/)

![WebUI: SvelteKit + Vite](https://svelte.dev/)

![Status: Unlocked & Optimized](#features)

![Agentic: Multi--Turn Engine](#-agent-control-center)

</div>

---

📖 Visão Geral

ΩFFFΣLLIa • llama.cpp • AlgMor24 é um fork avançado, destravado e de alta performance do ecossistema llama.cpp. Este projeto integra inferência local de última geração em C/C++ com um motor agêntico autônomo multi-turn, suporte nativo a FIM (Fill-in-the-Middle) para geração e preenchimento de código, Speculative Decoding otimizado para programação, integração de ferramentas MCP (Model Context Protocol) e uma interface Web moderna em SvelteKit/Vite com a identidade visual Cyberpunk Neon Fire.

---

✨

git clone https://github.com/brunoconta1980-tech/llama_OFFFELLIA_1984

cd llama_OFFFELLIA_1984

cmake -B build \

-DGGML_VULKAN=ON \

-DLLAMA_BUILD_WEBUI=ON \

-DLLAMA_SERVER_TOOLS=ON

cmake --build build -j

or

cmake -S . -B build-vulkan \

-DGGML_VULKAN=ON \

-DLLAMA_BUILD_WEBUI=ON \

-DLLAMA_SERVER_TOOLS=ON

cmake --build build-vulkan -j

###

Comando sugerido:

"/home/userk21/llama_OFFFELLIA_1984/build/bin/llama-server" \

-m "/home/userk21/Área de trabalho/userk21/LLMS/ΩFFFΣLLIα_IQ4_NL_gemma-4-26B-A4B-it-ultra-uncensored-heretic.gguf" \

-ngl 99 --n-cpu-moe 99 \

-c 50000 \

-ctk q8_0 \

-ctv q8_0 \

-t 4 \

-tb 4 \

-b 2048 \

-ub 1024 \

-fa on \

--cpu-strict 1 \

--parallel 1 \

--agent \

--tools all \

--reasoning auto \

--kv-unified \

--load-mode mmap \

--cors-origins "*" \

--webui-mcp-proxy \

--threads-http -1 \

--port 5173 \

--host 127.0.0.1

---

📜 Licença

Distribuído sob a licença MIT. Veja o arquivo LICENSE para mais detalhes.

Gracias https://github.com/charlie12345/ROCmFPX

---

<div align="center">

<b>ΩFFFΣLLIa • llama.cpp • AlgMor24 — Inferência Local, Descentralizada e Sem Limites</b>

</div>

Run Brunobkr/OFFFELLIA_Muse-Glimmer-30B-Heretic.gguf with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models

Source: Hugging Face · Compare models