OCR-Modell jina-ocr-v1: 83,4 Benchmark-Punkte bei 574 Millionen Parametern
Veröffentlicht am: 22.09.2026 um 11:43 Uhr | Redaktion boerse-global.de
Das Softwareunternehmen Elastic hat mit jina-ocr-v1 ein spezialisiertes Modell für die optische Zeichenerkennung und die End-to-End-Verarbeitung von Dokumenten vorgestellt. Wie aus Berichten vom 21. September 2026 hervorgeht, setzt das an der New Yorker Börse notierte Unternehmen bei der Neuentwicklung auf eine Mixture-of-Experts-Architektur, um hohe Verarbeitungsgeschwindigkeiten mit geringem Ressourcenaufwand zu kombinieren.
Hohe Benchmark-Werte bei reduzierter Modellgröße
Das Modell jina-ocr-v1 verfügt über insgesamt 3,4 Milliarden Parameter, aktiviert während der Inferenz jedoch lediglich 574 Millionen Parameter. Durch diese Struktur bietet das System nach Unternehmensangaben die Kostenstruktur und Geschwindigkeit eines Modells der Größenklasse unter 600 Millionen Parametern.
In Tests erzielte das Modell laut Berichten einen Wert von 83,4 auf der Benchmark olmOCR-bench. Elastic bezeichnet dies als das bislang höchste publizierte Ergebnis für Modelle mit weniger als 600 Millionen aktiven Parametern. Das System erreiche eine sogenannte Frontier-Genauigkeit, obwohl es nur rund ein Zehntel der Größe des führenden Benchmark-Modells aufweise.
Zur Notwendigkeit kompakterer und leistungsfähigerer Architekturen erklärte Han Xiao, Vice President of AI bei Elastic, dass Kunden eine unkomplizierte Digitalisierung benötigten. Herkömmliche Pipelines zur optischen Zeichenerkennung stießen insbesondere bei komplexeren Layouts regelmäßig an ihre Grenzen.
Während technologische Fortschritte wie jina-ocr-v1 die Digitalisierung beschleunigen, rücken auch neue regulatorische Anforderungen in den Fokus. Dieser kostenlose Report klärt auf, welche KI-Systeme als Hochrisiko gelten und was Unternehmen jetzt konkret tun müssen. Kostenlosen Umsetzungsleitfaden zum EU AI Act herunterladen
Breite Formatunterstützung und Markdown-Ausgabe
Technologisch nutzt jina-ocr-v1 die FastMTP-Technologie und unterstützt mehr als 100 Sprachen. Das Modell ist darauf ausgelegt, handschriftliche Vermerke, mathematische Formeln im LaTeX-Format sowie komplexe Tabellenstrukturen in HTML zu erfassen. Als Ausgangsmaterialien können unter anderem PDF-, PPTX- und XLSX-Dateien verarbeitet werden. Die strukturierte Ausgabe der erfassten Inhalte erfolgt im Markdown-Format.
Flexible Optionen für Bereitstellung und Lizenzierung
Für den Einsatz in Unternehmen und der Forschung stehen unterschiedliche Vertriebs- und Bereitstellungswege zur Verfügung. Das Modell wird über den herstellereigenen Dienst Elastic Cloud im Rahmen des Elastic Inference Service bereitgestellt. Zudem ist eine Nutzung über die Jina-Programmierschnittstelle nach dem Modell der nutzungsbasierten Abrechnung pro Token möglich.
Mit der Einführung moderner KI-Lösungen steigen auch die rechtlichen Compliance-Anforderungen für IT- und Rechtsabteilungen deutlich an. Ein kostenloser Download verschafft Ihnen jetzt den notwendigen Überblick über Fristen, Pflichten und Risikoklassen der aktuellen EU-Verordnung. EU AI Act in 5 Schritten verstehen
Für den lokalen Betrieb in eigenen Rechenzentren bietet das Unternehmen Container-Lösungen mit einer kommerziellen Lizenz an. Für akademische sowie nichtkommerzielle Anwendungszwecke stellt Elastic das Modell darüber hinaus auf der Plattform Hugging Face unter der Lizenz CC BY-NC 4.0 bereit.
