Brunobkr/OFFFELLIA_gpt-OZ-20b-heretic-derestricted.gguf overview
ΩFFFΣLLIa • llama.cpp • OFFFELLIA HERETIC <div align="center" <img src="./capa.png" alt="OFFFELLIA HERETIC Banner" width="100%" style="border radius: 12px; mar…
Runs locally from ~11.28 GB disk (12 GB VRAM class GPUs with llama.cpp / guIDE).
Repository Files & Downloads
Model Details
Model README
ΩFFFΣLLIa • llama.cpp • OFFFELLIA_HERETIC
<div align="center">
<img src="./capa.png" alt="OFFFELLIA_HERETIC Banner" width="100%" style="border-radius: 12px; margin-bottom: 15px; box-shadow: 0 4px 20px rgba(0, 102, 153, 0.3);" />
<p align="center">
<img src="./pix.jpeg" alt="OFFFELLIA_HERETIC Web UI -" width="100%" style="border-radius: 8px; margin-bottom: 15px; box-shadow: 0 4px 15px rgba(51, 255, 102, 0.15);" />
██████╗ ███████╗███████╗███████╗██╗ ██╗ ██╗ █████╗
██╔═══██╗██╔════╝██╔════╝██╔════╝██║ ██║ ██║██╔══██╗
██║ ██║█████╗ █████╗ █████╗ ██║ ██║ ██║███████║
██║ ██║██╔══╝ ██╔══╝ ██╔══╝ ██║ ██║ ██║██╔══██║
╚██████╔╝██║ ██║ ███████╗███████╗███████╗██║██║ ██║-HERETIC
╚═════╝ ╚═╝ ╚═╝ ╚══════╝╚══════╝╚══════╝╚═╝╚═╝ ╚═╝
<b>High-Performance LLM / VLM Inference & Autonomous Agentic Ecosystem in Pure C/C++</b>





</div>
---
📖 Visão Geral
ΩFFFΣLLIa • llama.cpp • AlgMor24 é um fork avançado, destravado e de alta performance do ecossistema llama.cpp. Este projeto integra inferência local de última geração em C/C++ com um motor agêntico autônomo multi-turn, suporte nativo a FIM (Fill-in-the-Middle) para geração e preenchimento de código, Speculative Decoding otimizado para programação, integração de ferramentas MCP (Model Context Protocol) e uma interface Web moderna em SvelteKit/Vite com a identidade visual Cyberpunk Neon Fire.
---
✨
git clone https://github.com/brunoconta1980-tech/llama_OFFFELLIA_1984
cd llama_OFFFELLIA_1984
cmake -B build \
-DGGML_VULKAN=ON \
-DLLAMA_BUILD_WEBUI=ON \
-DLLAMA_SERVER_TOOLS=ON
cmake --build build -j
or
cmake -S . -B build-vulkan \
-DGGML_VULKAN=ON \
-DLLAMA_BUILD_WEBUI=ON \
-DLLAMA_SERVER_TOOLS=ON
cmake --build build-vulkan -j
###
Comando sugerido:
"/home/userk21/llama_OFFFELLIA_1984/build/bin/llama-server" \
-m "/home/userk21/Área de trabalho/userk21/LLMS/ΩFFFΣLLIα_IQ4_NL_gemma-4-26B-A4B-it-ultra-uncensored-heretic.gguf" \
-ngl 99 --n-cpu-moe 99 \
-c 50000 \
-ctk q8_0 \
-ctv q8_0 \
-t 4 \
-tb 4 \
-b 2048 \
-ub 1024 \
-fa on \
--cpu-strict 1 \
--parallel 1 \
--agent \
--tools all \
--reasoning auto \
--kv-unified \
--load-mode mmap \
--cors-origins "*" \
--webui-mcp-proxy \
--threads-http -1 \
--port 5173 \
--host 127.0.0.1
---
📜 Licença
Distribuído sob a licença MIT. Veja o arquivo LICENSE para mais detalhes.
Gracias https://github.com/charlie12345/ROCmFPX
---
<div align="center">
<b>ΩFFFΣLLIa • llama.cpp • AlgMor24 — Inferência Local, Descentralizada e Sem Limites</b>
</div>
Run Brunobkr/OFFFELLIA_gpt-OZ-20b-heretic-derestricted.gguf with guIDE
Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.
Source: Hugging Face · Compare models