دليل إرشادي

كيفية استخراج النص من ملف PDF ممسوح ضوئياً

استخراج نص قابل للتحديد من ملف PDF ممسوح ضوئياً باستخدام OCR، ثم ترجمة النتيجة

ملف PDF الممسوح ضوئياً هو عبارة عن صورة للنص، لذا لا يمكنك تحديده أو البحث فيه أو نسخه أو ترجمته. تحوّل أداة OCR PDF من DocTranslating ملف PDF الممسوح ضوئياً أو القائم على الصور إلى طبقة نصية حقيقية وقابلة للتحديد بنقرات قليلة: افتح الأداة، وارفع المستند الممسوح ضوئياً، وحدد لغة المستند اختيارياً للحصول على نتائج أسرع وأكثر دقة، ثم انقر فوق استخراج النص. تدعم الأداة أكثر من 50 لغة، والنصوص المكتوبة بخط اليد، والكتابة من اليمين إلى اليسار مثل العربية والعبرية. بمجرد استلام ملف PDF المُعالج بـ OCR، يمكنك ترجمته أو البحث فيه أو النسخ منه تماماً كأي مستند عادي.

تم التحديث في 19 يونيو 2026 · 8 دقائق للقراءة

إذا حاولت تحديد نص في ملف PDF ولم يتم تظليل أي شيء، أو بحثت باستخدام Ctrl+F ولم تحصل على أي نتائج، فإن ملف PDF الخاص بك ممسوح ضوئياً — فهو صورة لصفحة وليس نصاً. وهذا هو السبب أيضاً في أن ترجمته أو النسخ منه أو تعديله لا يعمل. الحل هو التقنية الضوئية للتعرف على الحروف (OCR)، والتي تقرأ الصورة وتبني طبقة نصية حقيقية تحتها. يوضح هذا الدليل كيفية القيام بذلك باستخدام أداة OCR PDF من DocTranslating، وما يمكنك فعله بالنتيجة.

كيف أعرف ما إذا كان ملف PDF الخاص بي ممسوحاً ضوئياً؟

ثلاثة فحوصات سريعة تخبرك ما إذا كان ملف PDF يحتاج إلى OCR:

خطوة بخطوة: استخراج النص من ملف PDF ممسوح ضوئياً

  1. 1

    افتح أداة OCR PDF

    انتقل إلى أداة OCR PDF مباشرةً، أو — إذا كنت تحاول بالفعل ترجمة ملف ممسوح ضوئياً — انقر فوق زر "فتح أداة OCR PDF" في إشعار "يبدو أن هذا المستند ممسوح ضوئياً". كلا الطريقين يفتحان الأداة نفسها.

  2. 2

    ارفع ملف PDF الممسوح ضوئياً

    حدد ملف PDF الممسوح ضوئياً أو القائم على الصور الذي تريد تحويله. هذا هو الملف الذي لا يمكن تحديد النص فيه أو البحث عنه حالياً.

  3. 3

    حدد لغة المستند (اختياري)

    إذا كنت تعرف لغة المستند، فقم بتحديدها. هذا أمر اختياري — فالأداة تتعرف على اللغة تلقائياً — ولكن تحديدها يعطي نتائج أسرع وأكثر دقة، خاصة للنصوص غير اللاتينية مثل العربية أو الصينية أو السيريلية أو الديفاناغارية، وللنصوص المكتوبة بخط اليد.

  4. 4

    انقر فوق استخراج النص ونزّل النتيجة

    تقرأ الأداة الصفحات وتُعيد بناء طبقة نصية حقيقية وقابلة للتحديد مع الحفاظ على المظهر الأصلي للمستند. قم بتنزيل ملف PDF المُعالج بـ OCR — يمكنك الآن تحديد نصه والبحث فيه ونسخه، وأصبح جاهزاً للترجمة.

ما تجيد أداة OCR PDF التعامل معه

تعد تقنية OCR في DocTranslating واحدة من أكثر المحركات كفاءة المتاحة، وتتجاوز مجرد النصوص الإنجليزية المطبوعة البسيطة:

بعد التعرف الضوئي (OCR): ترجمة مستندك

بمجرد حصولك على ملف PDF المُعالج بـ OCR، تكون ترجمته مماثلة لترجمة أي ملف PDF عادي — قم برفه، واختر لغاتك ومحرك الترجمة، ثم نزّل النسخة المترجمة. إن تشغيل OCR أولاً كخطوة منفصلة يمنحك ميزة كبيرة واحدة: يمكنك قراءة النص المستخرج والتأكد من صحته قبل أن تترجم. تؤدي ترجمة مستند ممسوح ضوئياً دون التحقق منه إلى مضاعفة نوعين من الأخطاء — فالكلمة التي تمت قراءتها بشكل خاطئ تصبح كلمة مترجمة بشكل خاطئ بثقة — لذا فإن التحقق من مخرجات OCR أولاً هو أفضل طريقة للحصول على ترجمة نهائية دقيقة.

نصائح للحصول على أفضل نتائج OCR

تعتمد دقة OCR بشكل كبير على جودة المسح الضوئي للمستند. هناك بضعة أمور تحسّن النتائج بشكل ملحوظ:

بديل: OCR على PDFEquips

إذا كنت تعمل بالفعل داخل PDFEquips — على سبيل المثال لتحويل ملفات PDF أو ضغطها أو دمجها — فإنه يحتوي أيضاً على أداة OCR يمكنك استخدامها لجعل ملف PDF الممسوح ضوئياً قابلاً للبحث. أيٌّ من الطريقين يمنحك ملفاً مُعالَجاً بـ OCR يمكنك بعد ذلك إحضاره إلى DocTranslating لترجمته. استخدم ما يناسب سير عملك.

الأسئلة الشائعة

كيف يمكنني استخراج النص من ملف PDF ممسوح ضوئياً؟

افتح أداة OCR PDF من DocTranslating، وارفع ملف PDF الممسوح ضوئياً، وحدد لغة المستند اختيارياً للحصول على نتائج أسرع وأكثر دقة، ثم انقر فوق استخراج النص. تُعيد الأداة بناء طبقة نصية حقيقية وقابلة للتحديد مع الحفاظ على المظهر الأصلي للمستند، وتنزّل ملف PDF مُعالج بـ OCR يمكنك تحديده والبحث فيه ونسخه وترجمته.

كيف يمكنني معرفة ما إذا كان ملف PDF ممسوحاً ضوئياً أم يحتوي على نص حقيقي؟

حاول تحديد سطر من النص بمؤشر الماوس، أو ابحث في المستند باستخدام Ctrl+F (أو Cmd+F على Mac). إذا لم تتمكن من تظليل الكلمات الفردية، أو لم تظهر كلمة مرئية بوضوح في نتائج البحث، فإن ملف PDF ممسوح ضوئياً ويحتاج إلى OCR. في DocTranslating، يعرض فتح ملف ممسوح ضوئياً أيضاً إشعار "يبدو أن هذا المستند ممسوح ضوئياً" مع زر فتح أداة OCR PDF.

هل يمكن استخراج النصوص المكتوبة بخط اليد من ملف PDF؟

نعم. تتعرف أداة OCR PDF على النصوص المكتوبة بخط اليد بالإضافة إلى النصوص المطبوعة. يعطي الخط اليدوي الواضح والمقروء أفضل النتائج؛ بينما يكون الخط الفوضوي جداً أو المزخرف أكثر صعوبة على أي نظام OCR، لذا تتفاوت النتائج حسب درجة وضوح الخط.

هل يعمل OCR مع اللغة العربية والعبرية واللغات الأخرى التي تُكتب من اليمين إلى اليسار؟

نعم. تدعم أداة OCR PDF أبجديات الكتابة من اليمين إلى اليسار بما في ذلك العربية والعبرية والفارسية، وتُعيد بناء اتجاه القراءة الصحيح — وهو الجزء الأكثر صعوبة عادةً في مستندات RTL الممسوحة ضوئياً. هذا يجعل النص المستخرج قابلاً للاستخدام في البحث والترجمة بدلاً من أن يظهر بشكل مبعثر.

كم عدد اللغات التي تدعمها أداة OCR PDF؟

أكثر من 50 لغة، بما في ذلك العديد من اللغات ذات الأبجديات غير اللاتينية. يمكنك ترك الأداة لتكتشف اللغة تلقائياً، أو تحديدها يدوياً لاستخراج أسرع وأكثر دقة — ويعد تحديد اللغة مفيداً بشكل خاص للمستندات غير اللاتينية والمكتوبة بخط اليد.

هل أحتاج إلى تشغيل OCR قبل ترجمة ملف PDF ممسوح ضوئياً؟

هذا هو النهج الموصى به. يتيح لك تشغيل OCR كخطوة أولى منفصلة التحقق من صحة النص المستخرج قبل الترجمة، حتى لا تنتقل أخطاء التعرف إلى لغة أخرى. بمجرد حصولك على ملف PDF المُعالج بـ OCR، قم بترجمته تماماً كما تفعل مع أي ملف PDF عادي.

هل سيغير OCR مظهر مستندي؟

لا — تحافظ أداة OCR PDF على المظهر الأصلي للمستند وتضيف إليه طبقة نصية قابلة للتحديد. يظل ملفك الممسوح ضوئياً كما هو؛ والفرق الوحيد هو أنه يمكن الآن تحديد نصه والبحث فيه ونسخه وترجمته.

لماذا لا تترجم خدمة ترجمة جوجل أو الأدوات الأخرى ملف PDF الممسوح ضوئياً الخاص بي؟

معظم أجهزة الترجمة تقرأ فقط طبقة النص الموجودة في ملف PDF، بينما لا يحتوي ملف PDF الممسوح ضوئياً على هذه الطبقة — فهو عبارة عن صورة. لهذا السبب تعيد هذه الأدوات ملفاً فارغاً أو خطأً. يمنح استخراج النص باستخدام OCR أولاً المستند طبقة نصية حقيقية، يمكن بعد ذلك ترجمتها بشكل طبيعي.

How-to

كيفية ترجمة ملف PDF ممسوح ضوئياً (Scanned)

ملفات PDF الممسوحة ضوئياً هي عبارة عن صور للنصوص وليست نصوصاً حقيقية؛ ولهذا السبب فإن معظم أدوات الترجمة — بما في ذلك مترجم جوجل (Google Translate) — إما أن ترفضها، أو تعيد ملفاً فارغاً، أو تظهر خطأ "تعذر ترجمة هذا الملف". لترجمة ملف PDF ممسوح ضوئياً، تحتاج إلى تقنية التعرف الضوئي على الحروف (OCR) لاستخراج النص قبل الترجمة. يقوم موقع DocTranslating بتشغيل تقنية OCR تلقائياً كجزء من عملية الترجمة، ويدعم أكثر من 100 لغة، ويعيد بناء النص المترجم داخل نسخة تطابق الـ PDF الأصلي. لضمان الدقة في المستندات الهامة، تحقق من مخرجات الـ OCR أولاً عبر موقع PDFEquips حتى لا تتداخل أخطاء استخراج النصوص مع أخطاء الترجمة.

8 min read

دليل البدء

كيفية ترجمة مستند دون فقدان التنسيق الخاص به

يقوم DocTranslating بترجمة ملفات PDF، Word، PowerPoint، Excel، الأكواد، وملفات الترجمة النصية إلى أكثر من 100 لغة مع الحفاظ على التخطيط الأصلي، الخطوط، الجداول، والصور في مكانها. قم برفع ملف، اختر اللغة وأحد محركات الترجمة الأربعة (DeepL أو Microsoft Azure أو Google Cloud أو Gemini)، ثم قم بتنزيل نسخة مترجمة تبدو تماماً كالأصلية. يغطي هذا الدليل العملية بالكامل بالإضافة إلى الحالات العملية الخاصة — ملفات PDF الممسوحة ضوئياً، الحواشي السفلية ومربعات النصوص، تناسق المصطلحات، حدود حجم الملفات، واللغات التي تُكتب من اليمين إلى اليسار.

11 min read

← جميع الأدلة