ملخص
لاستخراج النص من PDF ممسوح ضوئيا، ارفع الملف إلى Batch Printer، واختر لغة المستند، ثم شغل OCR. بعد المعالجة يمكنك تنزيل PDF قابل للبحث ونسخ النص، مع الحفاظ على المظهر المرئي للمسح الأصلي.
كيفية تطبيق OCR على PDF
دليل خطوة بخطوة لاستخراج النص من ملفات PDF الممسوحة ضوئيا
- 1
ارفع PDF الممسوح
اسحب ملف PDF الممسوح ضوئيا وأفلته.
- 2
اختر اللغة
اختر لغة النص الموجود في المستند.
- 3
عالج ونزل
انقر على OCR لاستخراج النص، ثم نزل PDF القابل للبحث.
الأسئلة الشائعة
ما اللغات المدعومة؟
يدعم OCR لدينا عدة لغات، بما في ذلك الإنجليزية والكورية واليابانية والصينية ومعظم اللغات الأوروبية.
هل يستطيع OCR قراءة الملاحظات المكتوبة بخط اليد؟
يعمل OCR بأفضل شكل مع النصوص المطبوعة. قد يتعرف جزئيا على الخط اليدوي الواضح، لكن دقته في الخط اليدوي أقل من المستندات المطبوعة.
هل سيحافظ OCR على تخطيط الصفحة الأصلي؟
نعم، يبقى مظهر الصفحة متشابها بصريا مع إضافة طبقة نص قابلة للبحث. يمكنك أيضا عرض تنسيق المسح الأصلي.
كيف أحسن دقة OCR؟
استخدم مسوحا بدقة 300 DPI أو أعلى، مع صفحات مستقيمة وتباين قوي. قص الحواف الداكنة قبل OCR يساعد أيضا على تحسين جودة التعرف.
هل يمكنني نسخ النص بعد OCR؟
نعم، يجعل OCR الناجح النص قابلا للتحديد والبحث في معظم قارئات PDF. تعتمد الدقة على جودة المسح واختيار اللغة.
حالات استخدام عملية لـ OCR PDF
تستخدم مكاتب المحاماة OCR على سجلات القضايا الممسوحة ضوئيا حتى يتمكن المحامون من البحث عن الأسماء والتواريخ والبنود عبر مئات الصفحات أثناء التحضير لمرحلة discovery.
يستخدم الباحثون OCR على المقالات التاريخية والتقارير المطبوعة لاستخراج الاقتباسات وبناء أرشيفات أدبية قابلة للبحث دون إعادة الكتابة يدويا.
تستخدم فرق المحاسبة OCR على صور الفواتير الممسوحة حتى تصبح بنود السطور ومعرفات الموردين قابلة للبحث أثناء دورات التدقيق والمطابقة.
نصائح وأفضل الممارسات لاستخدام OCR PDF
- امسح المستندات القياسية بدقة 300 DPI على الأقل، واستخدم 400 DPI للخطوط الصغيرة.
- اختر اللغة الأساسية للمستند قبل المعالجة لتقليل أخطاء استبدال الأحرف.
- قم بتدوير الصفحات المائلة أو المقلوبة أولا. تنخفض دقة OCR بشدة عند عدم محاذاة النص.
- تجنب المسوح الأصلية المضغوطة بشدة، لأن آثار الضغط قد تربك اكتشاف الأحرف.
- راجع الحقول المهمة مثل الإجماليات والتواريخ والأسماء بعد OCR قبل استخدام البيانات المستخرجة في العمل.