OCR — টেক্সট এক্সট্র্যাকশন

একটি ডিজিটাল PDF থেকে টেক্সট এক্সট্র্যাক্ট করুন, অথবা স্ক্যান করা ছবিতে অপটিক্যাল ক্যারেক্টার রিকগনিশন চালান।

১০০% ফ্রি
সাইন-আপ ছাড়াই
ফাইল স্বয়ংক্রিয়ভাবে মুছে ফেলা হয়
নিরাপদ প্রসেসিং

OCR PDF কী এবং কেন আপনার এটি প্রয়োজন?

একটি স্ক্যান করা পৃষ্ঠা আসলে কেবল একটি ছবি: আপনার PDF রিডার একটি ছবি দেখে, শব্দ নয়। OCR PDF (অপটিক্যাল ক্যারেক্টার রিকগনিশন) সেই ছবিটি পড়ে, প্রতিটি অক্ষর শনাক্ত করে এবং এটিকে প্রকৃত, নির্বাচনযোগ্য ও অনুসন্ধানযোগ্য টেক্সটে পরিণত করে। এটাই একটি জমাট নথিকে আবার প্রাণ ফিরিয়ে দেয়।

এই ধাপ প্রতিদিনের কাজ বদলে দেয়। টেক্সট শনাক্ত হয়ে গেলে আপনি একটি অংশ কপি করতে পারেন, পুরো ফাইল জুড়ে একটি শব্দ খুঁজতে পারেন এবং নতুন করে টাইপ না করেই একটি কাগজের নথি পুনঃব্যবহার করতে পারেন। এ কারণেই আপনি একটি স্ক্যান করা PDF থেকে টেক্সট বের করেন: পুরনো চুক্তি, ডাকযোগে পাওয়া ইনভয়েস, পূরণ করা ফর্ম ও ডিজিটাইজড আর্কাইভ অবশেষে ব্যবহারযোগ্য হয়ে ওঠে।

কী নির্ভুলতাকে প্রভাবিত করে, এবং এরপর কী আসে

ফলাফল সবচেয়ে বেশি নির্ভর করে স্ক্যানের মানের উপর। 300 dpi বা তার বেশিতে স্ক্যান করা একটি ঝকঝকে, সোজা, উচ্চ-বৈসাদৃশ্যের নথি নির্ভরযোগ্য শনাক্তকরণ দেয়। সঠিক ভাষা নির্বাচন করতেও নিশ্চিত থাকুন, কারণ এটি অক্ষর ও উচ্চারণচিহ্ন কীভাবে ব্যাখ্যা হবে তা পরিচালনা করে। তবে হাতের লেখা অনির্ভরযোগ্য থেকে যায়: OCR মুদ্রিত টেক্সটের জন্য তৈরি।

টেক্সট বের হয়ে গেলে আপনি আপনার লক্ষ্যের জন্য পরবর্তী টুল বেছে নেন। একটি সম্পূর্ণ সম্পাদনাযোগ্য নথির জন্য pdf-to-word ব্যবহার করুন; ফাইলটি সরাসরি সমন্বয় করতে edit ব্যবহার করুন; আর ফরম্যাট বদলাতে convert-কে দায়িত্ব নিতে দিন।

গোপনীয়তা নিয়ে জটিল কিছু নেই: কোনো সাইন-আপ প্রয়োজন নেই এবং প্রক্রিয়া করার পর আপনার ফাইলগুলো স্বয়ংক্রিয়ভাবে মুছে ফেলা হয়। আপনার নথিগুলো কেবল আপনার টেক্সট তৈরির জন্যই ব্যবহৃত হয়, এর বেশি কিছু নয়।

কীভাবে OCR — টেক্সট এক্সট্র্যাকশন

  1. 1

    আপলোড

    ড্রপ এরিয়াতে আপনার PDF ফাইল আপলোড করুন (অথবা টেনে এনে ছেড়ে দিন)।

  2. 2

    কনফিগার

    একটি ডিজিটাল PDF থেকে টেক্সট এক্সট্র্যাক্ট করুন, অথবা স্ক্যান করা ছবিতে অপটিক্যাল ক্যারেক্টার রিকগনিশন চালান।

  3. 3

    ডাউনলোড

    এক ক্লিকে ফলাফল ডকুমেন্ট ডাউনলোড করুন — প্রসেসিংয়ের পর আপনার ফাইল স্বয়ংক্রিয়ভাবে মুছে ফেলা হয়।

প্রায়শই জিজ্ঞাসিত প্রশ্ন

How do I extract text from a scanned PDF?

Upload your scanned PDF: optical character recognition (OCR) analyses each page and extracts the text, which you can copy or download.

Which languages does the OCR recognise?

The OCR recognises French and English among others, with good accuracy on clean scanned documents.

Which languages does the text recognition support?

OCR recognises text in many languages, including French and English. Choosing the correct language clearly improves accuracy, especially for accents and special characters.

Does OCR work on a low-quality scan or handwriting?

A clear, well-contrasted scan gives the best results, while a blurry or very dark document lowers accuracy. Recognition targets printed text and handles handwriting poorly.

Is OCR PDF really free?

Yes, this tool is 100% free with no usage limits. No sign-up, no credit card and no watermark added to your documents.

Are my PDF files safe?

Yes. Your files are processed securely and automatically deleted from our servers after processing. Nobody has access to them.

সম্পর্কিত PDF টুল