Bild-/PDF-Textextraktor

Extrahieren und überprüfen Sie Text aus Screenshots, Fotos und PDFs in Ihrem Browser.

Wählen Sie Bilder oder ein PDF, wählen Sie die Textsprache und extrahieren Sie sie. Überprüfen Sie jede Seite neben dem Original, korrigieren Sie etwaige Fehler und kopieren Sie dann TXT oder laden Sie es herunter.

Wie zu verwenden

Extrahieren Sie Text aus einem Screenshot oder einer PDF-Datei

Wählen Sie Bilder oder ein PDF, wählen Sie die Textsprache und extrahieren Sie sie. Überprüfen Sie jede Seite neben dem Original, korrigieren Sie etwaige Fehler und kopieren Sie dann TXT oder laden Sie es herunter.

Beispiel und erwartetes Ergebnis

Beispiel: Die Musterrechnung enthält „Gesamt: 125,50 USD“. Vergleichen Sie die Nummern vor dem Kopieren mit dem Original. TXT behält Text- und Seitentrennzeichen bei; Tabellen oder PDF-Layout bleiben nicht erhalten.

Anerkennungsgrenzen

Bis zu 10 Bilder oder ein PDF mit 20 Seiten. Gedruckter Text funktioniert am besten. Tabellen, Handschriften und komplexe Spalten müssen manuell überprüft werden. Die bengalische Erkennung wird nicht unterstützt.

Überprüfen Sie die Ergebnisse für Arabisch, Urdu und Vietnamesisch sorgfältig: Durch gemischte Schriften oder Akzente können Zahlen oder Buchstaben fehlen.

Erster Download

Der Motor und ausgewählte Modelle werden bei Bedarf heruntergeladen. Dateien bleiben in diesem Browser. Der Qualitätsmodus lädt etwa 31 MB an Modellen plus Engine; Der Lightweight-Modus lädt etwa 6 MB an Modellen. Zwischengespeicherte Assets können wiederverwendet werden.

PDF-Textebenen

Vorhandener PDF-Text wird direkt extrahiert. Gescannte Seiten verwenden OCR. Die Erkennung dieser Seite erzwingt erneut OCR, wenn die ursprüngliche Textebene unvollständig ist. Der Export erfolgt als reiner Text, nicht als durchsuchbares PDF oder als Excel-Tabelle.