OCR — استخراج النص
استخرِج النص من ملف PDF رقمي، أو شغّل التعرف الضوئي على الأحرف في الصور الممسوحة ضوئياً.
أفلِت ملف PDF هنا أو انقر لاختياره
ملف PDF حتى 100 ميغابايت
استخرِج النص من ملف PDF رقمي، أو شغّل التعرف الضوئي على الأحرف في الصور الممسوحة ضوئياً.
أفلِت ملف PDF هنا أو انقر لاختياره
ملف PDF حتى 100 ميغابايت
الصفحة الممسوحة ضوئياً ليست في حقيقتها سوى صورة فوتوغرافية: فبرنامج قراءة PDF يرى صورة لا كلمات. تقوم تقنية OCR PDF (التعرّف الضوئي على الحروف) بتحليل هذه الصورة، وتمييز كل حرف، وتحويله إلى نص حقيقي يمكن تحديده والبحث فيه. إنها العملية التي تعيد الحياة إلى مستند جامد.
تُحدث هذه الخطوة فرقاً في العمل اليومي. فبمجرد التعرّف على النص، يمكنك نسخ فقرة، والبحث عن كلمة في الملف كله، وإعادة استخدام مستند ورقي دون إعادة كتابته. وهذا بالضبط سبب الحاجة إلى استخراج النص من ملف PDF: فالعقود القديمة، والفواتير الواردة بالبريد، والنماذج المعبّأة، والأرشيف الممسوح ضوئياً تصبح أخيراً قابلة للاستخدام.
تعتمد جودة النتيجة قبل كل شيء على جودة المسح الضوئي. فالمستند الواضح، المستقيم، وذو التباين العالي، الممسوح بدقة 300 نقطة في البوصة أو أكثر، يمنح تعرّفاً موثوقاً. احرص أيضاً على تحديد اللغة الصحيحة، لأنها توجّه تفسير الحروف والحركات. أما الكتابة اليدوية فتبقى غير موثوقة: فتقنية OCR مصمّمة للنص المطبوع.
بعد استخراج النص، تختار الأداة التالية حسب هدفك. للحصول على مستند قابل للتحرير بالكامل، استخدم pdf-to-word؛ ولتعديل الملف مباشرة، استخدم edit؛ ولتغيير الصيغة، تتولّى أداة convert المهمة.
أما من ناحية الخصوصية، فلا شيء معقّد: لا حاجة إلى إنشاء حساب، وتُحذف ملفاتك تلقائياً بعد المعالجة. تُستخدم مستنداتك فقط لإنتاج النص الخاص بك، لا أكثر.
التحميل
حمّل ملف PDF في منطقة الإسقاط (أو اسحبه وأفلته).
الإعداد
استخرِج النص من ملف PDF رقمي، أو شغّل التعرف الضوئي على الأحرف في الصور الممسوحة ضوئياً.
التنزيل
نزّل المستند الناتج بنقرة واحدة — تُحذف ملفاتك تلقائيًا بعد المعالجة.