KoarAI/LFM2.5-350M-Thinking-0005-GGUF overview
<p align="center" <img src="banner.png" alt="LFM2.5 350M Thinking 0005 Banner" width="100%" </p 🧠 LFM2.5 350M Thinking 0005 GGUF Quantized GGUF binaries of Ko…
Runs locally from ~360.5 MB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).
Repository Files & Downloads
Model Details
Model README
---
license: apache-2.0
language:
- ru
- en
tags:
- liquid-ai
- lfm2.5
- reasoning
- gguf
- llama-cpp
- ollama
---
<p align="center">
<img src="banner.png" alt="LFM2.5-350M-Thinking-0005 Banner" width="100%">
</p>
🧠 LFM2.5-350M-Thinking-0005-GGUF
Quantized GGUF binaries of KoarAI/LFM2.5-350M-Thinking-0005 for ultra-fast local inference on CPU, Vulkan, and Apple Metal via llama.cpp.
📦 Available Files
| File | Precision | Size | Description |
|---|---|---|---|
| LFM2.5-350M-Thinking-0005-f16.gguf | FP16 | ~709 MB | Full precision golden baseline |
| LFM2.5-350M-Thinking-0005-q8_0.gguf | Q8_0 | ~380 MB | High-quality quantized balance |
🚀 Quick Start (llama.cpp)
llama-cli -m LFM2.5-350M-Thinking-0005-f16.gguf -p "<|im_start|>user\nСколько букв 'р' в слове 'трапеция'? Разбери пошагово.\n<|im_end|>\n<|im_start|>assistant\n" -n 512 --temp 0.6Run KoarAI/LFM2.5-350M-Thinking-0005-GGUF with guIDE
Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.
Source: Hugging Face · Compare models