OCR: aus Scans werden Daten
Die flinq OCR ist in Entwicklung: eine domänenspezifische Texterkennung für Baudokumente. Sie wird Scans und Fotos in maschinenlesbaren Text und Struktur überführen.
Was ist OCR?
OCR steht für Optical Character Recognition, also optische Zeichenerkennung. Ein OCR-Modell liest Dokumente, die nur als Bild vorliegen, etwa Scans oder Fotos, und wandelt sie in maschinenlesbaren Text um. Gute OCR erkennt dabei auch die Struktur: Überschriften, Tabellen, Positionen und Mengen bleiben als solche erhalten.
Erst dieser Schritt macht ein Dokument für Software nutzbar. Was vorher ein Pixelbild war, wird zu Text und Struktur, die sich durchsuchen, extrahieren und weiterverarbeiten lassen.
Was bedeutet das für die Baubranche?
Ein großer Teil des Wissens im Bau liegt in Dokumenten, die nie digital strukturiert waren: gescannte Ausschreibungen, ältere Leistungsverzeichnisse, die nur als PDF existieren, Pläne und Produktdatenblätter. Generische Texterkennung scheitert oft an Fachbegriffen, Kurztexten, Einheiten und Tabellenlayouts dieser Dokumente.
Die flinq OCR wird auf Baudokumente ausgerichtet sein und diese Bestände lesbar machen. Das Ergebnis fließt direkt in die weiteren flinq Bausteine: Suche und Matching über die Embedding- und Reranking-API.
Die OCR ist in Entwicklung. Abonnieren Sie den Newsletter, um den Start nicht zu verpassen, oder schreiben Sie uns.