Nouplo

Text aus einer gescannten PDF auslesen

Aus Scans wird Text, den Sie kopieren und durchsuchen können, ohne dass das Dokument Ihr Gerät verlässt.

Dateien hier ablegen

oder klicken und vom Gerät auswählenUnterstützt: PDF

Bis zu 3 Dateien pro VorgangBis zu 20 MB pro Datei10 Vorgänge pro TagLimits mit Pro aufheben✓ Funktioniert offline

Ihre Dateien bleiben auf Ihrem Gerät

Dieses Tool läuft vollständig in Ihrem Browser. Es wird nichts hochgeladen und nichts gespeichert. Sie können sogar die Internetverbindung trennen, bevor Sie beginnen.

So funktioniert es

  1. Legen Sie eine PDF im Feld ab: einen Scan, ein abfotografiertes und als PDF gespeichertes Dokument oder jede andere PDF, deren Text Sie brauchen.
  2. Lassen Sie „Seiten“ leer, um die ganze Datei zu lesen, oder geben Sie Seiten wie 1-3, 5 ein. Pro Durchgang werden bis zu 20 gescannte Seiten gelesen.
  3. Klicken Sie auf „Text auslesen“. Beim ersten Mal werden die Texterkennungsmodelle und ihre Laufzeitumgebung geladen, zusammen etwa 11 MB.
  4. Kopieren Sie den Text aus dem Feld oder laden Sie ihn als .txt-Datei herunter. Die Seiten sind mit --- 1 ---, --- 2 --- usw. gekennzeichnet.

Häufige Fragen

Wird die PDF dadurch durchsuchbar?
Diese Seite liefert Ihnen den Text. Soll die PDF selbst erhalten bleiben und durchsuchbar werden, nutzen Sie „PDF durchsuchbar machen“. Dort wird derselbe erkannte Text als unsichtbare Ebene über jede gescannte Seite gelegt.
Was passiert mit Seiten, die schon Text enthalten?
Ihr Text wird direkt aus der PDF übernommen, sofort und exakt. Nur Seiten ohne verwertbaren Text, etwa Scans, durchlaufen die Texterkennung.
Warum nur 20 gescannte Seiten auf einmal?
Das Lesen einer Seite dauert einige Sekunden und braucht im Browser viel Arbeitsspeicher. Einen längeren Scan lesen Sie in Etappen, zum Beispiel erst 1-20 und dann 21-40.
Welche Dokumente funktionieren, und wie genau?
Gedruckter Text auf Deutsch und Englisch, außerdem auf Französisch, Spanisch, Italienisch, Portugiesisch, Türkisch und Japanisch. Auf unseren deutschen Testseiten (Rechnungen, Briefe, Kassenbons und App-Screenshots, als Scan, Foto oder Screenshot) war weniger als 1 von 100 Zeichen falsch, Umlaute und ß wurden richtig gelesen, und alle Beträge und Datumsangaben stimmten. Da die Testseiten erzeugt waren, schneiden verblasste Belege und schlechte Scans schwächer ab. Handschrift wird nicht zuverlässig gelesen, und mehrspaltige Seiten können mit vermischten Spalten herauskommen. Prüfen Sie das Ergebnis, bevor Sie es verwenden.
Wird meine PDF hochgeladen?
Nein. Die Seiten werden in Ihrem Browser dargestellt und gelesen. Das Tool liest eine PDF pro Vorgang; im kostenlosen Tarif gelten bis zu 20 MB pro Datei und 10 Vorgänge pro Tag, mit Pro entfallen diese Limits.

Für einen bestimmten Zweck

Verwandte Tools