Open Source
Offene Modelle und Datensätze. Veröffentlicht auf Hugging Face, lauffähig mit Ollama.
Ein Teil unserer Arbeit ist offen: die Generationen bis German-OCR 3.1, die 1B-Generation von Mankei, das Belegant-Modell und der Benchmark BelegBench, alle unter Apache 2.0. Modellkarten, Gewichte und Datensätze liegen auf Hugging Face.
/ Modelle
Offene Modelle unter Apache 2.0.
Apache 2.0
Hugging Face · Ollama
Vision-OCR für deutsche Geschäftsdokumente
Bild rein, strukturiertes JSON raus: Rechnung, Brief, Formular, Quittung, Bescheid, Vertrag. Vorgängergeneration von German-OCR 4.
OllamaApache 2.0Text-Assistent für Übersetzung, Zusammenfassung und Analyse
Das Textmodell der German-OCR-3-Kollektion, für den lokalen Betrieb ausgelegt.
OllamaApache 2.0Schweizer Belege und QR-Rechnungen als strukturiertes JSON
Deutsch, Französisch, Italienisch. QR-IBAN- und Referenzlogik, Schweizer Zahlenformat, gültige Mehrwertsteuersätze.
OllamaApache 2.0Deutsches Chat-Modell, von Grund auf in Deutschland trainiert
1,01 Milliarden Parameter, eigener deutscher Tokenizer, für den CPU-Betrieb gebaut.
OllamaApache 2.0Chat auf Bairisch, Übertragung aus dem Hochdeutschen
Aus dem Mankei-Basismodell abgeleitet und auf bairischen Dialekt weitertrainiert.
OllamaApache 2.0Deutscher Embedder für Suche und Retrieval
Kompakt und CPU-fähig; auf Rechtstexten vor deutlich größeren mehrsprachigen Modellen.
Reranker für deutsche Trefferlisten
Zweite Stufe hinter dem Embedder: ordnet Kandidaten nach Relevanz.
Modelle, Datensätze und Modellkarten auf Hugging Face
Gewichte, Quantisierungen und Dokumentation zu allen offenen Modellen unter keyvan-ai; ältere Veröffentlichungen unter Keyven.
↗/ Datensätze
Benchmarks zum Nachrechnen.
10.002 synthetische Belege aus CH, DE und AT
Vollständige Ground Truth, prüfsummenkorrekte Kennungen, scannbare QR-Codes, Scan-Degradation. Version 2, August 2026.
5.888 Aufgaben nach Baunormen aus DE, AT und CH
Kostenpflichtig lizenziert; Zugang zur Prüfung per Zugangsanfrage auf Hugging Face. Verifiziert mit SOFiSTiK, PyNite und anaStruct.
/ Weitere Veröffentlichungen
Modelle aus Forschung und Sicherheit.
Neben den Produktmodellen sind Forschungsmodelle zu Anomalieerkennung, Netzwerksicherheit und Sprachaktivierung sowie ein agentisches Framework zur Schwachstellensuche veröffentlicht. Forschung und Publikationen laufen über die persönliche Seite von Keyvan Hardani, keyvan.ai.
/ Plattformen
Wo die Veröffentlichungen liegen.
Hugging Face, Ollama und GitHub sind Marken der jeweiligen Inhaber. Die Nennung beschreibt, wo Modelle und Datensätze veröffentlicht sind; eine geschäftliche Verbindung besteht nicht.
