Open Source

Offene Modelle und Datensätze. Veröffentlicht auf Hugging Face, lauffähig mit Ollama.

Ein Teil unserer Arbeit ist offen: die Generationen bis German-OCR 3.1, die 1B-Generation von Mankei, das Belegant-Modell und der Benchmark BelegBench, alle unter Apache 2.0. Modellkarten, Gewichte und Datensätze liegen auf Hugging Face.

Offene Modelle: Gewichte, Modellkarten, Datensätze Ziehen zum Drehen ↻

/ Modelle

Offene Modelle unter Apache 2.0.

Apache 2.0
Hugging Face · Ollama

German-OCR 3.1

Vision-OCR für deutsche Geschäftsdokumente

Bild rein, strukturiertes JSON raus: Rechnung, Brief, Formular, Quittung, Bescheid, Vertrag. Vorgängergeneration von German-OCR 4.

Hugging FaceOllamaApache 2.0
German-Text 3.1

Text-Assistent für Übersetzung, Zusammenfassung und Analyse

Das Textmodell der German-OCR-3-Kollektion, für den lokalen Betrieb ausgelegt.

Hugging FaceOllamaApache 2.0
Belegant-4B

Schweizer Belege und QR-Rechnungen als strukturiertes JSON

Deutsch, Französisch, Italienisch. QR-IBAN- und Referenzlogik, Schweizer Zahlenformat, gültige Mehrwertsteuersätze.

Hugging FaceOllamaApache 2.0
Mankei-1B-Chat

Deutsches Chat-Modell, von Grund auf in Deutschland trainiert

1,01 Milliarden Parameter, eigener deutscher Tokenizer, für den CPU-Betrieb gebaut.

Hugging FaceOllamaApache 2.0
Mankei-Boarisch

Chat auf Bairisch, Übertragung aus dem Hochdeutschen

Aus dem Mankei-Basismodell abgeleitet und auf bairischen Dialekt weitertrainiert.

Hugging FaceOllamaApache 2.0
Mankei-326M-Embedder

Deutscher Embedder für Suche und Retrieval

Kompakt und CPU-fähig; auf Rechtstexten vor deutlich größeren mehrsprachigen Modellen.

Hugging FaceApache 2.0
Mankei-326M-Reranker

Reranker für deutsche Trefferlisten

Zweite Stufe hinter dem Embedder: ordnet Kandidaten nach Relevanz.

Hugging FaceApache 2.0
Alle Veröffentlichungen

Modelle, Datensätze und Modellkarten auf Hugging Face

Gewichte, Quantisierungen und Dokumentation zu allen offenen Modellen unter keyvan-ai; ältere Veröffentlichungen unter Keyven.

/ Weitere Veröffentlichungen

Modelle aus Forschung und Sicherheit.

keyvan.ai ↗

Neben den Produktmodellen sind Forschungsmodelle zu Anomalieerkennung, Netzwerksicherheit und Sprachaktivierung sowie ein agentisches Framework zur Schwachstellensuche veröffentlicht. Forschung und Publikationen laufen über die persönliche Seite von Keyvan Hardani, keyvan.ai.

AnomalyDetection-MVTech-MetalAnomalieerkennung auf Metalloberflächen (Bildsegmentierung), Apache 2.0. Hugging Face ↗
CanDefender, CANDefender-DoS, CanDefender-FuzzyErkennung von Angriffen auf Fahrzeug-Bussysteme (CAN), CC BY-NC-ND 4.0. Hugging Face ↗
SecIDS-CNN, SecIDS-v2Intrusion-Detection-Modelle für Netzwerkverkehr, CC BY-NC 4.0. Hugging Face ↗
WakeCoreSprachaktivierung (Audio-Klassifikation), MIT. Hugging Face ↗
mythos-researchAgentisches Framework zur Schwachstellensuche in Quellcode, Apache 2.0; Grundlage mehrerer veröffentlichter CVEs. GitHub ↗ · Advisories ↗

/ Plattformen

Wo die Veröffentlichungen liegen.

Hugging Face, Ollama und GitHub sind Marken der jeweiligen Inhaber. Die Nennung beschreibt, wo Modelle und Datensätze veröffentlicht sind; eine geschäftliche Verbindung besteht nicht.

Anfrage mit Dokumentart, Menge im Monat und Zielsystem. Sie erhalten eine fachliche Einschätzung.
Kontaktformular Demo-Umgebung German-OCR StatikBench einsehen