Holen Sie Text aus Fotos und Screenshots. Deutsch und Englisch werden zusammen gelesen, und jede Zeile trägt ihren eigenen Konfidenzwert.
So geht's
- Bilder mit Text hochladen. Mehrere auf einmal sind kein Problem.
- Sprache wählen. Enthält das Dokument kein Englisch, macht die Einzelsprache weniger Fehler.
- „Text lesen“ drücken. Der erste Lauf braucht ein paar Sekunden mehr, um das Modell zu laden.
- Ergebnis kopieren oder als .txt herunterladen. Blass dargestellte Zeilen hatten einen niedrigen Wert — prüfen Sie diese.
Wird mein Bild hochgeladen?
Nein. Erkennungsmodul und Sprachdaten werden in Ihren Browser geladen, alles passiert auf Ihrem Gerät. Damit sind Visitenkarten, Ausweise und Verträge unbedenklich.
Warum ist der erste Lauf langsam?
Er lädt einmalig das Modul (rund 2,7 MB) und die Sprachdaten. Danach bleiben sie im Browser-Cache und die Erkennung startet sofort.
Liest es Handschrift?
Kaum. Das Modul ist auf gedruckte Zeichen trainiert, bei Handschrift fällt die Genauigkeit stark ab. Nutzen Sie es für Druck, Screenshots und Beschilderung.
Wie verbessere ich die Genauigkeit?
Größere, schärfere Zeichen helfen am meisten. Ein schiefes Foto vorher mit dem Zuschneiden-Werkzeug gerade rücken. Bei sehr niedriger Auflösung ist ein neues Foto besser als Hochskalieren. Auch die Sprache auf das zu beschränken, was wirklich im Dokument steht, macht einen spürbaren Unterschied.
Ist eine einzelne Sprache immer genauer?
Nein. Für rein einsprachige Dokumente ja, aber sobald anderer Text auftaucht, wird es schlechter. Am selben Testbild las die gemischte Einstellung die E-Mail-Adresse korrekt und verwechselte dafür ein Wort, die Einzelsprache genau umgekehrt. Richten Sie die Einstellung nach dem Inhalt des Dokuments.
Bleiben Tabellen oder Formatierung erhalten?
Nein. Es wird nur der Text Zeile für Zeile extrahiert. Tabellenstruktur, Schriften und Farben werden nicht übernommen.
Kann ich Text aus einem PDF holen?
Beim Hochladen eines PDFs wird die erste Seite in ein Bild umgewandelt und gelesen. Enthält das PDF bereits echten Text, ist das Kopieren aus einem PDF-Betrachter genauer. OCR ist für Scans gedacht, in denen der Text nur als Bild existiert.