ما هو OCR؟
OCR (التعرف الضوئي على الحروف) تقنية تنظر إلى صورة تحتوي نصًا وتحدد الحروف الفعلية المطبوعة عليها — لتحوّل صورة الكلمات إلى نص حقيقي قابل للقراءة بواسطة الحاسوب.
الفكرة الأساسية
الصفحة الممسوحة أو الصورة هي مجرد بكسلات — لا يعرف الحاسوب بطبيعته أن مجموعة من البكسلات الداكنة تمثل حرف "A". يحلل OCR الأشكال في الصورة، يقارنها بأنماط حروف معروفة، ويُخرج النص الذي يتعرف عليه، مع موضع كل جزء من النص في الصفحة.
ما يؤثر على دقة OCR
دقة الصورة ووضوحها هما الأهم — مسح بدقة منخفضة أو صورة غير واضحة يعطي OCR معلومات أقل للعمل بها. اختيار الخط مهم أيضًا: الخطوط النظيفة والقياسية تُتعرَّف عليها بشكل أكثر موثوقية من النصوص المزخرفة أو المكتوبة بخط اليد. ويحتاج محرك OCR لمعرفة اللغة المتوقعة، لأن اللغات المختلفة تستخدم أشكال وقواعد حروف مختلفة.
أين يُستخدم OCR
جعل ملفات PDF الممسوحة قابلة للبحث (راجع "ما هو ملف PDF القابل للبحث") أحد الاستخدامات الشائعة. من الاستخدامات الأخرى رقمنة الكتب المطبوعة، وقراءة النص في الصور لتطبيقات الترجمة، وأتمتة إدخال البيانات من النماذج أو الإيصالات.
OCR ليس مثاليًا
حتى OCR الجيد يرتكب أخطاء، خصوصًا على صور مصدر منخفضة الجودة أو خطوط غير معتادة أو خط يد. الناتج هو أفضل تعرّف ممكن، لا ضمان دقة 100% — للنص الذي يجب أن يكون دقيقًا تمامًا، قارن دائمًا مع الأصل.
هل يمكن لـ OCR قراءة الخط اليدوي؟
تُحسَّن أدوات OCR العامة (مثل التعرف على النص في PDF في FileBench) للنص المطبوع وتتعامل معه بموثوقية أكبر بكثير من الخط اليدوي، الذي يتفاوت كثيرًا بين الأفراد لنتائج ثابتة.
الأسئلة الشائعة
هل يعمل OCR مع أي لغة؟
يعتمد ذلك على اللغات التي يدعمها محرك OCR — تدعم أداة جعل PDF قابلًا للبحث في FileBench الإنجليزية والعربية (بما في ذلك المستندات المختلطة)، لا كل اللغات.