GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →
Model Intelligence Sheet

keyvan-ai/german-ocr-2b-gguf overview

German OCR 2B GGUF Kompaktes Vision Language Modell für deutsche Dokumenten OCR. Highlights 1.5 GB Läuft auf jedem Laptop 100% Genauigkeit auf deutschen Dokume…

ggufocrvision-language-modelgermandocument-aillama-cppimage-text-to-textdeenbase_model:Qwen/Qwen3-VL-2B-Instructbase_model:quantized:Qwen/Qwen3-VL-2B-Instructlicense:apache-2.0endpoints_compatibleregion:usconversational

Runs locally from ~424.4 MB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).

Downloads
0
Likes
0
Pipeline
image-text-to-text
Author

Repository Files & Downloads

2 GGUF files detected
Direct downloads for local inference
FileTypeQuantizationSizeLink
German-OCR-Engine.2B.ggufGGUFGGUF1.03 GBDownload
German-OCR-Worker-2B.ggufGGUFGGUF424.4 MBDownload

Model Details

Model IDkeyvan-ai/german-ocr-2b-gguf
Authorkeyvan-ai
Pipelineimage-text-to-text
Licenseapache-2.0
Base modelQwen/Qwen3-VL-2B-Instruct
Last modified2026-07-09T19:15:38.000Z

Model README

---

license: apache-2.0

language:

  • de
  • en

tags:

  • ocr
  • vision-language-model
  • german
  • document-ai
  • gguf
  • llama-cpp

base_model: Qwen/Qwen3-VL-2B-Instruct

pipeline_tag: image-text-to-text

---

German-OCR 2B (GGUF)

Kompaktes Vision-Language Modell für deutsche Dokumenten-OCR.

Highlights

  • 1.5 GB - Läuft auf jedem Laptop
  • 100% Genauigkeit auf deutschen Dokumenten
  • GPU/NPU-Support: CUDA, Metal, Vulkan, OpenVINO
  • CPU-Inferenz ohne GPU möglich

Dateien

| Datei | Größe | Beschreibung |

|-------|-------|--------------|

| German-OCR-Engine.2B.gguf | 1.03 GB | LLM Engine (Q4_K) |

| German-OCR-Worker-2B.gguf | 424 MB | Vision Encoder |

Verwendung mit llama.cpp

llama-mtmd-cli \
  -m German-OCR-Engine.2B.gguf \
  --mmproj German-OCR-Worker-2B.gguf \
  --image rechnung.png \
  -p "Extrahiere den Text aus diesem Dokument:" \
  -ngl 99

Verwendung mit Python

pip install german-ocr[llamacpp]
from german_ocr import GermanOCR

ocr = GermanOCR(backend="llamacpp")
text = ocr.extract("rechnung.png")
print(text)

Performance

| Hardware | Speed | Accuracy |

|----------|-------|----------|

| RTX 4060 | 127 tok/s | 100% |

| CPU-only | 23 tok/s | 100% |

Links

Lizenz

Apache 2.0

Autor

Keyvan Hardani - keyvan.ai

Run keyvan-ai/german-ocr-2b-gguf with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models

Source: Hugging Face · Compare models