Brunobkr/OFFFELLIA_coder3101_gemma-4-E4B-8b_666-tensors-heretic.gguf overview
ΩFFFΣLLIa • llama.cpp • OFFFELLIA HERETIC <div align="center" <img src="./capa.png" alt="OFFFELLIA HERETIC Banner" width="100%" style="border radius: 12px; mar…
Runs locally from ~4.82 GB disk (8 GB VRAM class GPUs with llama.cpp / guIDE).
Repository Files & Downloads
| File | Type | Quantization | Size | Link |
|---|---|---|---|---|
| ΩFFFΣLLIα_F16_coder3101_gemma-4-E4B-8b_666-tensors-heretic.gguf | GGUF | F16 | 13.92 GB | Download |
| ΩFFFΣLLIα_IQ4_NL_coder3101_gemma-4-E4B-8b_666-tensors-heretic.gguf | GGUF | IQ4_NL_CODER3101_GEMMA | 4.82 GB | Download |
| ΩFFFΣLLIα_Q4_K_coder3101_gemma-4-E4B-8b_666-tensors-heretic.gguf | GGUF | Q4_K_CODER3101_GEMMA | 4.94 GB | Download |
| ΩFFFΣLLIα_Q5_K_coder3101_gemma-4-E4B-8b_666-tensors-heretic.gguf | GGUF | Q5_K_CODER3101_GEMMA | 5.33 GB | Download |
| ΩFFFΣLLIα_Q6_K_coder3101_gemma-4-E4B-8b_666-tensors-heretic.gguf | GGUF | Q6_K_CODER3101_GEMMA | 5.75 GB | Download |
| ΩFFFΣLLIα_Q8_0_coder3101_gemma-4-E4B-8b_666-tensors-heretic.gguf | GGUF | Q8_0_CODER3101_GEMMA | 7.43 GB | Download |
Model Details
Model README
ΩFFFΣLLIa • llama.cpp • OFFFELLIA_HERETIC
<div align="center">
<img src="./capa.png" alt="OFFFELLIA_HERETIC Banner" width="100%" style="border-radius: 12px; margin-bottom: 15px; box-shadow: 0 4px 20px rgba(0, 102, 153, 0.3);" />
<p align="center">
<img src="./pix.jpeg" alt="OFFFELLIA_HERETIC Web UI -" width="100%" style="border-radius: 8px; margin-bottom: 15px; box-shadow: 0 4px 15px rgba(51, 255, 102, 0.15);" />
██████╗ ███████╗███████╗███████╗██╗ ██╗ ██╗ █████╗
██╔═══██╗██╔════╝██╔════╝██╔════╝██║ ██║ ██║██╔══██╗
██║ ██║█████╗ █████╗ █████╗ ██║ ██║ ██║███████║
██║ ██║██╔══╝ ██╔══╝ ██╔══╝ ██║ ██║ ██║██╔══██║
╚██████╔╝██║ ██║ ███████╗███████╗███████╗██║██║ ██║-HERETIC
╚═════╝ ╚═╝ ╚═╝ ╚══════╝╚══════╝╚══════╝╚═╝╚═╝ ╚═╝
<b>High-Performance LLM / VLM Inference & Autonomous Agentic Ecosystem in Pure C/C++</b>





</div>
---
📖 Visão Geral
ΩFFFΣLLIa • llama.cpp • AlgMor24 é um fork avançado, destravado e de alta performance do ecossistema llama.cpp. Este projeto integra inferência local de última geração em C/C++ com um motor agêntico autônomo multi-turn, suporte nativo a FIM (Fill-in-the-Middle) para geração e preenchimento de código, Speculative Decoding otimizado para programação, integração de ferramentas MCP (Model Context Protocol) e uma interface Web moderna em SvelteKit/Vite com a identidade visual Cyberpunk Neon Fire.
---
✨
git clone https://github.com/brunoconta1980-tech/llama_OFFFELLIA_1984
TKS TO: https://huggingface.co/coder3101/models
cd llama_OFFFELLIA_1984
cmake -B build \
-DGGML_VULKAN=ON \
-DLLAMA_BUILD_WEBUI=ON \
-DLLAMA_SERVER_TOOLS=ON
cmake --build build -j
or
cmake -S . -B build-vulkan \
-DGGML_VULKAN=ON \
-DLLAMA_BUILD_WEBUI=ON \
-DLLAMA_SERVER_TOOLS=ON
cmake --build build-vulkan -j
###
Comando sugerido:
"/home/userk21/OFFFELLIA_llama.cpp_Neon_Themes/build/bin/llama-server" \
-m "/home/userk21/Área de trabalho/userk21/LLMS/ΩFFFΣLLIα_Q5_K_coder3101_gemma-4-E4B-8b_666-tensors-heretic.gguf" \
-ngl 99 --n-cpu-moe 99 \
-c 50000 \
-t 5 \
-tb 5 \
-ctk q8_0 \
-ctv q8_0 \
-fa on \
--cpu-strict 1 \
--parallel 1 \
--agent \
--tools all \
--reasoning auto \
--kv-unified \
--load-mode mmap \
--cors-origins "*" \
--webui-mcp-proxy \
--threads-http -1 \
--port 8080 \
--host 127.0.0.1
---
📜 Licença
Distribuído sob a licença MIT. Veja o arquivo LICENSE para mais detalhes.
Gracias https://github.com/charlie12345/ROCmFPX
---
<div align="center">
<b>ΩFFFΣLLIa • llama.cpp • AlgMor24 — Inferência Local, Descentralizada e Sem Limites</b>
</div>
Run Brunobkr/OFFFELLIA_coder3101_gemma-4-E4B-8b_666-tensors-heretic.gguf with guIDE
Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.
Source: Hugging Face · Compare models