OCR — szövegkinyerés

Nyerj ki szöveget digitális PDF-ből, vagy futtass optikai karakterfelismerést beszkennelt képeken.

100% ingyenes
Regisztráció nélkül
A fájlok automatikusan törlődnek
Biztonságos feldolgozás

Mi az OCR PDF, és miért van rá szüksége?

Egy beszkennelt oldal valójában csak egy fénykép: a PDF-olvasója képet lát, nem szavakat. Az OCR PDF (optikai karakterfelismerés) beolvassa ezt a képet, azonosítja minden betűt, és valódi, kijelölhető és kereshető szöveggé alakítja. Ez az, ami életre kelti a befagyasztott dokumentumot.

Ez a lépés megváltoztatja a mindennapi munkát. Amint a szöveg felismerésre kerül, kimásolhat egy részletet, szót kereshet az egész fájlban, és újrahasználhat egy papíralapú dokumentumot anélkül, hogy újragépelné. Pontosan ezért nyeri ki a szöveget egy beszkennelt PDF-ből: régi szerződések, postán érkezett számlák, kitöltött űrlapok és digitalizált archívumok végre használhatóvá válnak.

Mi befolyásolja a pontosságot, és mi jön ezután

Az eredmény mindenekelőtt a szkennelés minőségétől függ. Egy éles, egyenes, nagy kontrasztú, 300 DPI vagy annál nagyobb felbontással beszkennelt dokumentum megbízható felismerést ad. Ügyeljen arra is, hogy a helyes nyelvet válassza, mivel ez irányítja a karakterek és az ékezetek értelmezését. A kézírás azonban megbízhatatlan marad: az OCR nyomtatott szöveghez készült.

Amint a szöveg kinyerésre került, a céljához választja a következő eszközt. Teljesen szerkeszthető dokumentumhoz használja a pdf-to-word eszközt; a fájl közvetlen módosításához használja az edit eszközt; a formátumok megváltoztatásához pedig hagyja, hogy a convert vegye át.

Az adatvédelemet illetően semmi bonyolult: semmilyen regisztráció nem szükséges, és fájljait feldolgozás után automatikusan töröljük. Dokumentumait kizárólag a szöveg előállítására használjuk, semmi másra.

Hogyan OCR — szövegkinyerés

  1. 1

    Feltöltés

    Töltsd fel a PDF fájlt a feltöltési mezőbe (vagy húzd oda).

  2. 2

    Beállítás

    Nyerj ki szöveget digitális PDF-ből, vagy futtass optikai karakterfelismerést beszkennelt képeken.

  3. 3

    Letöltés

    Töltsd le a kész dokumentumot egyetlen kattintással — a fájljaid a feldolgozás után automatikusan törlődnek.

Gyakori kérdések

How do I extract text from a scanned PDF?

Upload your scanned PDF: optical character recognition (OCR) analyses each page and extracts the text, which you can copy or download.

Which languages does the OCR recognise?

The OCR recognises French and English among others, with good accuracy on clean scanned documents.

Which languages does the text recognition support?

OCR recognises text in many languages, including French and English. Choosing the correct language clearly improves accuracy, especially for accents and special characters.

Does OCR work on a low-quality scan or handwriting?

A clear, well-contrasted scan gives the best results, while a blurry or very dark document lowers accuracy. Recognition targets printed text and handles handwriting poorly.

Is OCR PDF really free?

Yes, this tool is 100% free with no usage limits. No sign-up, no credit card and no watermark added to your documents.

Are my PDF files safe?

Yes. Your files are processed securely and automatically deleted from our servers after processing. Nobody has access to them.

Kapcsolódó PDF eszközök