OCR — Extrakce textu
Extrahujte text z digitálního PDF nebo spusťte optické rozpoznávání znaků na skenovaných obrázcích.
Přetáhněte sem své PDF nebo klikněte pro výběr
PDF až do 100 MB
Extrahujte text z digitálního PDF nebo spusťte optické rozpoznávání znaků na skenovaných obrázcích.
Přetáhněte sem své PDF nebo klikněte pro výběr
PDF až do 100 MB
Naskenovaná stránka je ve skutečnosti jen fotografie: vaše čtečka PDF vidí obrázek, ne slova. OCR PDF (optické rozpoznávání znaků) čte tento obrázek, identifikuje každé písmeno a promění jej ve skutečný, vybíratelný a prohledávatelný text. Právě to vrací zmrazený dokument zpět k životu.
Tento krok mění každodenní práci. Jakmile je text rozpoznán, můžete zkopírovat pasáž, vyhledat slovo v celém souboru a znovu použít papírový dokument bez přepisování. Přesně proto extrahujete text z naskenovaného PDF: staré smlouvy, faktury přijaté poštou, vyplněné formuláře a digitalizované archivy se konečně stanou použitelnými.
Výsledek závisí především na kvalitě skenu. Ostrý, rovný, kontrastní dokument naskenovaný při 300 dpi nebo více dává spolehlivé rozpoznání. Nezapomeňte také vybrat správný jazyk, protože ten řídí, jak se interpretují znaky a diakritika. Rukopis však zůstává nespolehlivý: OCR je vytvořeno pro tištěný text.
Jakmile je text extrahován, vyberete další nástroj podle svého cíle. Pro plně upravitelný dokument použijte pdf-to-word; k přímé úpravě souboru použijte edit; a ke změně formátů nechte převzít otěže convert.
K ochraně soukromí není nic složitého: není vyžadována žádná registrace a vaše soubory se po zpracování automaticky smažou. Vaše dokumenty se používají pouze k vytvoření vašeho textu, nic víc.
Nahrát
Nahrajte svůj PDF soubor do oblasti pro vložení (nebo jej přetáhněte).
Nastavit
Extrahujte text z digitálního PDF nebo spusťte optické rozpoznávání znaků na skenovaných obrázcích.
Stáhnout
Stáhněte výsledný dokument jedním kliknutím — vaše soubory se po zpracování automaticky smažou.