Auf 200+ echten anonymisierten deutschen Rechnungen (Default-Edition, 2.7 GB)
Was ist German-OCR-3?
German-OCR-3 ist eine kompakte, schnelle und voll lokal lauffähige Vision-OCR-Distribution für deutsche Geschäftsdokumente — Rechnungen, Briefe, Formulare, Quittungen, Bescheide. Aus dem Bild kommt strikt validiertes JSON nach unserem deutschen Extraktions-Schema. Ohne Cloud-Pflicht, ohne Vendor-Lock-in.
Zwei Editionen, beide Apache 2.0, beide unter 3 GB:
Edition
Ollama
Größe
Zielhardware
Stärke
Nano
Keyvan/german-ocr-nano
1.0 GB
CPU · Edge · Mobile
„läuft überall"
Default ⭐
Keyvan/german-ocr-3
2.7 GB
4–6 GB VRAM
beste Field-Erkennung
Fine-tuned adapter für deutsche Geschäftsdokument-Extraktion. Apache 2.0.
📊 Praxistest — 200+ echte deutsche Rechnungen (anonymisiert)
Praxistest
Edition
Valid JSON
Sender korrekt
Halluzination
Latenz
Keyvan/german-ocr-nano
84 %
79 %
0 %
6.6 s
Keyvan/german-ocr-3 ⭐
100 %
95 %
0 %
5.0 s
Keine "Mustermann"-Defaults. German-OCR-3 liest echte Firma, Kundenadresse, Produkte, Beträge — statt zu raten.
📐 Größenvergleich
Modellgrößen
german-ocr-3 (2.7 GB) ist 6× kleiner als ein typischer 7B-OCR-VLM. Läuft auf einer 8 GB-Gaming-GPU oder über CPU auf einem normalen Laptop.
Latenz
🚀 Quickstart
Ollama (empfohlen, eine Zeile)
bash
1ollama pull Keyvan/german-ocr-3
2ollama run Keyvan/german-ocr-3 "Extrahiere die Rechnung im Bild als JSON." ./meine_rechnung.png
Beispiel-Output (anonymisiert, aus Praxistest) — klicken zum Aufklappen
json
1{2"document_type":"invoice",3"language":"de",4"invoice_number":"100137xXXXXX",5"invoice_date":"2024-01-22",6"due_date":"2024-01-27",7"sender":{8"name":"IONOS SE",9"address":"Elgendorfer Str. 57, 56410 Montabaur",10"vat_id":"DE81556XXX",11"iban":null12},13"recipient":{14"name":"Firma e.K.",15"address":"Muster Straße 32, 80335 München",16"customer_id":"5835XXX"17},18"line_items":[19{"position":1,"description":"Mail Business 1 Liz.","quantity":1,20"unit":"Monat","unit_price_net":4.20,"amount_net":4.20,"vat_rate":19}21],22"amount_net":4.20,23"amount_vat":0.80,24"amount_total":5.00,25"currency":"EUR",26"notes":["Entsprechend Ihrem SEPA-Lastschriftmandat ..."]27}
Python (via Ollama HTTP API)
python
1import base64, json, requests
2from pathlib import Path
34b64 = base64.b64encode(Path("rechnung.png").read_bytes()).decode()5resp = requests.post("http://localhost:11434/api/generate", json={6"model":"Keyvan/german-ocr-3",7"prompt":"Extrahiere die Rechnung im Bild als JSON.",8"images":[b64],9"stream":False,10"options":{"temperature":0,"num_ctx":32768},11})12data = json.loads(resp.json()["response"])13print(json.dumps(data, indent=2, ensure_ascii=False))
Solo-Builder & Indies — deutsche Dokumente lokal extrahieren, ohne Cloud-OCR-Kosten.
DACH-KMU mit Datenschutz-Anspruch — lokal / on-prem hosten.
Agenturen & Studios — Open-Source-Fundament unter der eigenen Pipeline.
Wer es gemanagt und mit noch größeren Modellen will:
🌐 german-ocr.de — gehostete deutsche OCR-API mit Premium-Modellen, höherer Genauigkeit, ohne eigene Hardware. Daten bleiben in der EU.
⚠️ Limitations
Optimiert für deutsche Dokumente — andere Sprachen keine Garantie.
Beste Qualität bei klaren, hochauflösenden Scans/Fotos.
Handschriftliche Dokumente: nur begrenzt.
Bei kritischen Vorgängen (Buchhaltung, Recht): immer Human-in-the-Loop.
🙏 Credit & Attribution
German-OCR-3 baut auf der hervorragenden Arbeit des Qwen-Teams bei Alibaba Group auf. Die zugrundeliegende Vision-Language-Architektur stammt aus der Qwen 3.5 Small Series, veröffentlicht unter Apache License 2.0. Ohne die offene Forschung und die saubere Veröffentlichung der Qwen-Weights wäre dieses Projekt nicht möglich.