انتقل إلى المحتوى
PDFlora

ما هو OCR وكيف يعمل؟

حُدِّث في 23 سبتمبر 2026

تقنية OCR، أي التعرف الضوئي على الحروف، هي برنامج يقرأ الحروف في الصورة ويحوّلها إلى نص يستطيع الحاسوب البحث فيه ونسخه وتعديله. بفضلها يصبح العقد الممسوح ضوئياً قابلاً للبحث، ويمكنك استخراج فقرة من صفحة مصوَّرة. يشرح هذا الدليل طريقة العمل، وما الذي يحدد الدقة، وأين ما زال OCR يخطئ.

المشكلة التي يحلها OCR

يرى الحاسوب الصفحة الممسوحة ضوئياً شبكة من النقاط الملونة. لا يعرف أن مجموعة من البكسلات الداكنة هي حرف معيّن، فلا يوجد ما يمكن البحث فيه أو تحديده أو نسخه. والأمر نفسه ينطبق على صورة إيصال بالهاتف أو لقطة شاشة أو ملف PDF مصنوع من مسوحات ضوئية.

يسد OCR هذه الفجوة. ينظر إلى البكسلات ويقرر أي الحروف تشكّلها ثم يعيد نصاً حقيقياً. وحين يتوفر النص يصبح ممكناً كل ما تتوقعه من مستند رقمي: البحث والنسخ والترجمة والفهرسة والتحويل إلى Word أو نص عادي.

كيف يعمل OCR خطوة بخطوة

تتبع محركات OCR الحديثة مساراً متشابهاً. تختلف الأساليب الدقيقة من محرك إلى آخر، لكن المراحل معروفة.

  • التحضير: تُحوَّل الصورة إلى أبيض وأسود أو تدرجات رمادية، وتُنظَّف من البقع، وأحياناً تُعدَّل إذا كانت الصفحة مائلة قليلاً.
  • تحليل التخطيط: يحدد المحرك كتل النص والأسطر والكلمات، ويستنتج ترتيب القراءة.
  • التعرف: يُقارَن كل سطر بما تعلمه المحرك عن أشكال حروف اللغة المختارة. ويستخدم Tesseract، وهو المحرك مفتوح المصدر الذي تعتمد عليه أداتنا، شبكة عصبية في هذه المرحلة.
  • التدقيق اللغوي: تُقارَن الكلمات المرشحة بمعرفة اللغة، مما يساعد على الاختيار بين أشكال متقاربة.
  • الناتج: يُعاد النص المُتعرَّف عليه، إما كملف نصي وإما كطبقة مخفية محاذية للصورة الأصلية.

ما الذي يحدد الدقة

الصورة هي العامل الأهم. المسح الواضح بدقة 300 DPI والمستقيم، ذو النص الداكن على خلفية فاتحة، يمكن التعرف عليه جيداً جداً. أما الصور الضبابية والظلال والدقة المنخفضة والحبر الباهت والخلفيات الملونة والزخارف المزدحمة خلف النص فتقلل الدقة.

العامل الثاني هو إعداد اللغة: يحتاج المحرك إلى معرفة الأبجدية المتوقعة. فاختيار الإنجليزية لمستند فرنسي مثلاً يعطي حروفاً مشكّلة خاطئة أو مفقودة. والعامل الثالث هو الخط: الخطوط المطبوعة الواضحة سهلة، والخطوط الزخرفية والطباعة الصغيرة جداً أصعب.

الأخطاء المعتادة وكيف تبدو

نادراً ما يفشل OCR كلياً، لكنه يرتكب أخطاء صغيرة يمكن توقعها. من أشهرها الخلط بين الرقم 0 والحرف O، وبين الرقم 1 والحرف l الصغير والحرف I الكبير، أو قراءة rn على أنها m. وتتحول البقع على الورق إلى علامات ترقيم غريبة.

لذلك تستحق الأرقام والرموز والأسماء نظرة ثانية، خاصة في الفواتير والعقود وأرقام الهوية. وحين يكون لرقم واحد خاطئ أثر، قارن النص بالصورة الأصلية بدل الوثوق به بلا تدقيق.

الخط اليدوي والجداول والأبجديات

يعطي OCR أفضل نتائجه مع النص المطبوع. أما الخط اليدوي فلا يُتعرَّف عليه بموثوقية، والخط المتصل أصعب بكثير من الحروف المنفصلة المرتبة. وقد ترتبك الجداول والأعمدة والنماذج في ترتيب القراءة، لأن المحرك يرى كتل نص لا منطق الجدول.

وتؤثر الأبجدية كذلك. العربية تُكتب متصلة من اليمين إلى اليسار، فهي أصعب من النص اللاتيني البسيط. في أداتنا OCR PDF تُقرأ العربية والروسية، لكنك تحصل على النتيجة في ملف txt لا كطبقة PDF قابلة للبحث. أما اللغات ذات الحروف اللاتينية فيمكن للأداة إنتاج ملف PDF قابل للبحث لها أيضاً.

ما الذي ينتجه OCR

هناك ناتجان شائعان. النص العادي هو الكلمات المُتعرَّف عليها في ملف txt، ويفيد حين تريد إعادة استخدام المحتوى. أما PDF القابل للبحث فيحتفظ بصورة الصفحة الأصلية ويضيف طبقة نص غير مرئية، فيبدو المستند دون تغيير لكن يمكن البحث فيه ونسخه.

تستطيع أداة OCR PDF إنتاج أحدهما أو كليهما، بالإنجليزية والفرنسية والإسبانية والعربية والألمانية والإيطالية والبرتغالية والهولندية والتركية والروسية. وتعمل داخل متصفحك بمحرك Tesseract.js دون رفع مستنداتك. يُنزَّل محرك OCR وبيانات اللغة مرة واحدة من شبكة CDN عامة عند أول استخدام، ويستغرق التعرف بضع ثوانٍ لكل صفحة.

OCR مقارنةً بالأدوات المجاورة

لا يلزم OCR إلا حين لا تحتوي الصفحة على نص. إذا كان ملف PDF مصدَّراً من Word أو برنامج آخر فهو يحتوي نصاً بالفعل، ويمكن لأداتي PDF إلى نص وPDF إلى Word قراءته مباشرة. وتشغيل OCR على ملف كهذا يضيف عملاً بلا فائدة، ولهذا تستطيع OCR PDF تخطي الصفحات التي فيها نص.

اعتبر OCR الخطوة الأولى مع الملفات الممسوحة ضوئياً. تعرّف على الصفحات، ثم اختر الصيغة التي تحتاجها فعلاً: ملف PDF قابل للبحث للأرشفة، أو ملف نصي لإعادة الاستخدام، أو مستند Word قابل للتعديل لإجراء تغييرات.

الأسئلة الشائعة

ماذا تعني كلمة OCR؟

تعني التعرف الضوئي على الحروف. وهي التقنية التي تحوّل صور النص المطبوع أو المكتوب على الآلة إلى نص مقروء للآلة يمكن البحث فيه ونسخه وتعديله.

هل دقة OCR تصل إلى 100 بالمئة؟

لا. تعتمد الدقة على جودة المسح الضوئي وإعداد اللغة ونوع الخط. الصفحات المطبوعة الواضحة والمستقيمة يُتعرَّف عليها جيداً، بينما تنتج الصور الضبابية والطباعة الصغيرة والخط اليدوي أخطاء، فراجع الأرقام والأسماء المهمة.

هل يستطيع OCR قراءة الخط اليدوي؟

ليس بموثوقية. النص المطبوع يعمل جيداً، لكن الخط اليدوي يختلف كثيراً من شخص إلى آخر فتكون النتائج ضعيفة غالباً، خاصة مع الخط المتصل. والحروف المنفصلة المرتبة أفضل من الكتابة المتصلة.

هل يرفع OCR مستندي إلى خادم؟

ليس مع أداة OCR PDF. يعمل التعرف داخل متصفحك باستخدام WebAssembly، فلا تُرفع المستندات أبداً. يُنزَّل فقط محرك OCR وملفات اللغة مرة واحدة من شبكة CDN عامة.

الأدوات المذكورة في هذا الدليل

المزيد من الأدلة