Bild in Text (OCR)
Text aus Fotos, Screenshots und Scans im Browser extrahieren und dann bearbeiten, kopieren oder als .txt-Datei speichern. Nichts wird hochgeladen.
So funktioniert es
Wählen Sie ein oder mehrere Bilder aus, ziehen Sie sie auf das Werkzeug oder fügen Sie einen Screenshot mit Ctrl+V ein. Das Werkzeug liest sie nacheinander und gibt den gesamten Text in einem einzigen Feld aus, in dem Sie ihn korrigieren können, bevor Sie ihn kopieren oder als .txt-Datei herunterladen. Bei mehreren Bildern beginnt der Text jedes Bildes mit einer Zeile, die den Dateinamen zeigt; so wissen Sie, woher jeder Teil stammt.
Wählen Sie die Sprache des Textes, bevor Sie die Bilder hinzufügen. Wenn Sie sie später ändern oder die Lesereihenfolge wechseln, werden die Bilder erneut gelesen. Die Sprache ist wichtig, weil sie der Engine sagt, welche Buchstaben und Akzente zu erwarten sind: Portugiesischer Text, der als Englisch gelesen wird, kann Akzente wie ç und ã verlieren. Die Lesereihenfolge ist für das Layout wichtig: „Zeile für Zeile“ hält jede Zeile einer Tabelle oder eines Kassenbons zusammen, während „Spalten und Blöcke“ eine Seite mit Spalten Spalte für Spalte liest.
Die Erkennungs-Engine ist Tesseract, die Open-Source-OCR-Engine, die als WebAssembly in Ihrem Browser läuft. Ihre Bilder werden weder zu nTools noch zu einem anderen Dienst hochgeladen. Beim ersten Mal lädt der Browser die Engine (etwa 1,5 MB) und die Daten für die gewählte Sprache (0,7 bis 3 MB) herunter; danach kommen sie normalerweise aus dem Browser-Cache.
Die Engine wurde mit gedrucktem Text trainiert. Handschrift wird nicht unterstützt, und unscharfe Fotos, schräger Text, sehr kleine Buchstaben, dekorative Schriftarten sowie heller Text auf unruhigem Hintergrund führen zu Fehlern. Kleine Bilder, etwa die meisten Screenshots, werden vor dem Lesen automatisch vergrößert; das hilft bei kleinem Text in Benutzeroberflächen. Die angezeigte Erkennungssicherheit ist die eigene Schätzung der Engine, gemittelt über den gefundenen Text: ein nützliches Warnsignal, aber keine Garantie. Prüfen Sie daher Namen, Zahlen und Beträge anhand des Bildes.
TIFF-Dateien werden Seite für Seite gelesen, auch mehrseitige Scans und Dateien mit ZIP-, LZW-, JPEG- oder Fax-Komprimierung. JPEG- und HEIC-Fotos werden anhand ihrer Ausrichtungsangaben richtig herum gedreht; Text, der im Bild selbst seitlich oder auf dem Kopf steht, wird jedoch nicht gedreht. Jedes Bild darf bis zu 30 MB, 40 Megapixel und 12.000 Pixel Kantenlänge haben, und es lassen sich bis zu 20 Dateien auf einmal lesen (ein mehrseitiges TIFF zählt als eine Datei).
Beispiel
Screenshot einer Fehlermeldung (PNG)Die Meldung als Text, den Sie in eine Suche oder ein Support-Ticket einfügen können.Foto eines gedruckten Briefes, frontal aufgenommen (JPEG)Der Text des Briefes, bereit zum Korrigieren und zum Speichern als .txt-Datei.Mehrseitiges TIFF von einem ScannerDer Text jeder Seite, jeweils mit dem Dateinamen und der Seitenzahl als Überschrift.Foto eines Kassenbons, „Zeile für Zeile“ gelesenJeder Artikel steht in derselben Zeile wie sein Preis. Prüfen Sie die Beträge: Eine 5 kann als S gelesen werden oder ein Komma als Punkt.
Häufige Fragen
Werden meine Bilder hochgeladen?
Nein. Der Text wird in Ihrem Browser erkannt, und die Bilder und der Text bleiben auf Ihrem Gerät. Der Browser lädt von nTools nur herunter, was er zum Lesen braucht: die Erkennungs-Engine, die Sprachdaten und, bei TIFF- oder HEIC-Dateien, einen Decoder. Mit diesen Anfragen wird weder ein Bild noch Text gesendet.
Kann das Werkzeug Handschrift lesen?
Nein. Die Engine wurde mit gedrucktem Text trainiert; Handschrift liefert daher schlechte Ergebnisse, es sei denn, sie ist sehr gleichmäßig und kommt Blockbuchstaben nahe.
Warum ist ein Teil des Textes falsch oder fehlt?
Die häufigsten Ursachen sind ein unscharfes oder schräges Foto, kleine oder blasse Buchstaben, ein unruhiger Hintergrund oder eine falsch gewählte Sprache. Fotografieren Sie gerade von vorn und bei gutem Licht oder schneiden Sie das Bild auf den Text zu, und versuchen Sie es erneut. Verwenden Sie für Tabellen und Kassenbons die Lesereihenfolge „Zeile für Zeile“.
Kann ich Text aus einem PDF extrahieren?
Nicht hier: Dieses Werkzeug liest Bilder. Wenn das PDF gescannt wurde, wandeln Sie seine Seiten mit dem Werkzeug „PDF in Bilder“ in PNG-Bilder mit 144 DPI um und lassen Sie diese hier lesen. Wenn Sie den Text im PDF markieren können, ist er bereits Text; ihn zu kopieren ist dann genauer als OCR.
Bleibt die Formatierung erhalten?
Nein. Das Ergebnis ist reiner Text mit Zeilenumbrüchen, ohne Schriftarten, Fettdruck, Spalten oder Tabellen. Genau das enthält eine .txt-Datei.