OCR — Textextraktion

Extrahieren Sie Text aus einem digitalen PDF oder führen Sie eine optische Zeichenerkennung an gescannten Bildern durch.

100 % kostenlos
Ohne Anmeldung
Dateien automatisch gelöscht
Sichere Verarbeitung

Was ist OCR für PDF und warum brauchen Sie es?

Eine gescannte Seite ist in Wirklichkeit nur eine Fotografie: Ihr PDF-Reader sieht ein Bild, keine Wörter. OCR für PDF (optische Zeichenerkennung) liest dieses Bild, identifiziert jeden Buchstaben und verwandelt ihn in echten, auswählbaren und durchsuchbaren Text. Das ist es, was ein eingefrorenes Dokument wieder zum Leben erweckt.

Dieser Schritt verändert die tägliche Arbeit. Sobald der Text erkannt ist, können Sie eine Passage kopieren, ein Wort über die ganze Datei hinweg suchen und ein Papierdokument wiederverwenden, ohne es neu einzutippen. Genau deshalb extrahieren Sie Text aus einem gescannten PDF: alte Verträge, per Post erhaltene Rechnungen, ausgefüllte Formulare und digitalisierte Archive werden endlich nutzbar.

Was die Genauigkeit beeinflusst und was als Nächstes kommt

Das Ergebnis hängt vor allem von der Qualität des Scans ab. Ein scharfes, gerades, kontrastreiches Dokument, das mit 300 dpi oder mehr gescannt wurde, liefert eine zuverlässige Erkennung. Achten Sie außerdem darauf, die richtige Sprache auszuwählen, denn sie steuert, wie Zeichen und Akzente interpretiert werden. Handschrift bleibt jedoch unzuverlässig: OCR ist für gedruckten Text gemacht.

Sobald der Text extrahiert ist, wählen Sie das nächste Tool für Ihr Ziel. Für ein vollständig bearbeitbares Dokument verwenden Sie pdf-to-word; um die Datei direkt anzupassen, verwenden Sie edit; und um Formate zu ändern, übernimmt convert.

Zum Datenschutz ist nichts kompliziert: Es ist keine Anmeldung erforderlich, und Ihre Dateien werden nach der Verarbeitung automatisch gelöscht. Ihre Dokumente werden ausschließlich dazu verwendet, Ihren Text zu erzeugen, mehr nicht.

So gehts: OCR — Textextraktion

  1. 1

    Hochladen

    Laden Sie Ihre PDF-Datei in den Ablagebereich hoch (oder ziehen Sie sie per Drag-and-drop hinein).

  2. 2

    Einstellen

    Extrahieren Sie Text aus einem digitalen PDF oder führen Sie eine optische Zeichenerkennung an gescannten Bildern durch.

  3. 3

    Herunterladen

    Laden Sie das erstellte Dokument mit einem Klick herunter — Ihre Dateien werden nach der Verarbeitung automatisch gelöscht.

Verwandte PDF-Tools