PDF-Texterkennung
Erkennt Text in gescannten Seiten – auch auf Deutsch.
Die PDF-Texterkennung erkennt den Text in gescannten Seiten mit Tesseract und schreibt ihn als durchsuchbare Textebene unter den Scan. Die Erkennungs-Engine und die Sprachdaten werden einmalig als Programmcode geladen; Ihr Scan bleibt auf Ihrem Gerät.
Die PDF-Texterkennung (OCR) erkennt den Text in gescannten Seiten und legt eine unsichtbare, durchsuchbare Textebene über die Originalbilder. Das Ergebnis ist eine PDF, deren Text Sie markieren, kopieren und durchsuchen können – erstellt in Ihrem Browser, ohne Upload.
PDF-Texterkennung: Schritte & typische Anwendungen
Wofür Leute das nutzen
Für alle mit einem Scan, den sie nicht durchsuchen oder kopieren können.
- Einen gescannten Vertrag oder Bescheid durchsuchbar machen
- Text aus einem abfotografierten Brief kopieren
- Ältere gescannte Unterlagen nach einem Begriff durchsuchen
- Einen Scan für die Ausgabe als Textdatei vorbereiten
- Eingescannte Belege nach Namen oder Beträgen durchsuchen
So geht’s
- Fügen Sie Ihre gescannte PDF hinzu; die Seitenbilder werden auf Ihrem Gerät verarbeitet.
- Wählen Sie die Sprache des Dokuments, zum Beispiel Deutsch – oder mehrere, wenn das Dokument gemischt ist.
- Starten Sie die Texterkennung; sie läuft Seite für Seite.
- Sehen Sie sich die durchsuchbare PDF an und laden Sie sie herunter, oder speichern Sie den erkannten Text als .txt-Datei.
Fragen zu PDF-Texterkennung 5
Werden meine Dateien hochgeladen?
Nein. Die Erkennung läuft in Ihrem Browser, und Ihr Dokument bleibt auf Ihrem Gerät. Die Erkennungs-Engine (etwa 14 MB für den englischen Pfad) wird einmalig von unboundpdf.com geladen und danach vom Browser zwischengespeichert; weitere Sprachen wie Deutsch sind eigene, einmalige Downloads. Nur dafür braucht es anfangs eine Internetverbindung.
Kann es deutsche Texte lesen?
Ja. Deutsch gehört zu den Sprachen, deren Sprachdaten direkt auf unboundpdf.com liegen. Wählen Sie Deutsch als Sprache des Dokuments; bei gemischten Dokumenten können Sie mehrere Sprachen kombinieren oder sich von der automatischen Erkennung eine vorschlagen lassen.
Wie sieht das Ergebnis aus?
Eine durchsuchbare PDF: Ihre Originalseitenbilder mit einer unsichtbaren Textebene darüber, sodass sich der Text markieren und durchsuchen lässt. Den erkannten Text können Sie auch als reine Textdatei herunterladen.
Warum ist manches falsch erkannt?
Die Genauigkeit hängt von der Qualität des Scans ab. Klare, hoch aufgelöste Scans in der gewählten Sprache geben die besten Ergebnisse; unscharfe oder schiefe Seiten erzeugen mehr Fehler.
Verschlechtert die Texterkennung meinen Scan?
Nein. Ihre Originalseitenbilder bleiben genau so, wie sie sind – die Texterkennung fügt nur eine unsichtbare, markierbare Textebene hinzu.
So werden Ihre Dateien behandelt
Die Arbeit läuft auf Ihrem eigenen Gerät, im Browser-Tab – deshalb gibt es keinen Server, an den Ihr Dokument gesendet würde.
- Nichts wird hochgeladen. Wir haben kein Backend, das Dokumente empfängt oder speichert. Deshalb können wir Ihre Dateien weder während der Verarbeitung noch danach sehen.
- Ihr Gerät erledigt die Arbeit. Große Dokumente werden in Etappen verarbeitet, Seiten werden erst dargestellt, wenn Sie zu ihnen kommen, und jeder Auftrag wird vor dem Start mit Ihrem Gerät abgeglichen. Ein langer Lauf dauert auf einem Handy länger als auf einem Laptop, nichts wartet hinter den Aufträgen anderer, und Sie können einen Lauf jederzeit stoppen, ohne Ihre Originaldatei anzutasten.
- Kein Konto und kein Wasserzeichen. Das Ergebnis ist eine saubere Datei, die Sie überall verwenden können – ohne Anmeldung und ohne stündliche Begrenzung.
Hinweis zur Texterkennung: Die Erkennungs-Engine wird einmalig von dieser Website geladen, deshalb dauert der Start einen Moment. Sie kommt von uns, nicht von einem Drittanbieter, und Ihre PDF verlässt Ihr Gerät nicht.
Prüfen Sie es selbst: Wie das mit den Entwicklerwerkzeugen Ihres Browsers geht, steht unter Vertrauen & Überprüfung.
Weitere Werkzeuge auf Deutsch
Sie arbeiten genauso – in Ihrem Browser, ohne Anmeldung.