التعرف الضوئي على PDF

استخرج النص من ملفات PDF الممسوحة ضوئيًا واجعلها قابلة للبحث. يكتشف لغة المستند تلقائيًا. محلي 100% — لا شيء يُرفع.

✓ بدون حدود لحجم الملفات ✓ بدون حاجة لإنشاء حساب ✓ بدون إضافة علامات مائية ✓ مجاني إلى الأبد
أسقط الملفات هنا
أو انقر للتصفح — أي عدد من الملفات
ملفاتك لا تغادر المتصفح أبدًا — معالجة محلية، بدون رفع

التعرف الضوئي المجاني على PDF (OCR) — اجعل ملفات PDF الممسوحة ضوئيًا قابلة للبحث

استخرج النص من ملفات PDF الممسوحة ضوئيًا، اجعلها قابلة للبحث، وانسخ المحتوى — مباشرة في متصفحك باستخدام التعرف الضوئي على الحروف (OCR). بدون برامج للتثبيت، بدون حاجة لحساب، وملفاتك لا تغادر جهازك أبدًا.

تكتشف PDFree تلقائيًا لغة مستندك قبل تشغيل التعرف الضوئي، حتى لا تحتاج إلى التخمين — تعمل على العقود الممسوحة ضوئيًا والكتب الدراسية والفواتير ووثائق الأرشيف بعشرات اللغات وأنظمة الكتابة.

ما هو التعرف الضوئي (OCR)؟ يحوّل التعرف الضوئي على الحروف (OCR) ملف PDF المصوَّر — مستندًا ممسوحًا ضوئيًا تكون فيه كل صفحة صورة فوتوغرافية — إلى ملف PDF قابل للبحث، وذلك بإضافة طبقة نصية غير مرئية فوق الصور الأصلية. تُشغّل PDFree التعرف الضوئي بالكامل داخل متصفحك باستخدام Tesseract.js؛ ملفك لا يُرفع أبدًا إلى أي خادم. يُحفَظ مظهر المستند الأصلي بدقة تامة.

كيفية جعل ملف PDF الممسوح ضوئيًا قابلًا للبحث

1
افتح ملف PDF الممسوح ضوئيًا

اسحب وأفلت الملف أو انقر على اختر PDF. تكتشف PDFree تلقائيًا ما إذا كان ملف PDF لديك يحتوي بالفعل على طبقة نصية أو أنه صورة ممسوحة ضوئيًا بحتة.

2
دع PDFree يكتشف اللغة، أو اختَرها بنفسك

لملفات PDF الممسوحة ضوئيًا: انقر على تثبيت محرك OCR لتحميل Tesseract.js (حوالي 17 ميجابايت، تنزيل لمرة واحدة). تأخذ PDFree عينة من الصفحة وتقترح لغة المستند تلقائيًا؛ يمكنك تجاوزها من القائمة المنسدلة عند الحاجة. تتخطى ملفات PDF ذات الطبقة النصية هذه الخطوة بالكامل.

3
انقر على "اجعل PDF قابلًا للبحث"

يعالج محرك التعرف على النص كل صفحة محليًا — لا شيء يُرفع. يعرض شريط تقدّم الوقت المتبقي المتوقّع.

4
نزّل ملف PDF القابل للبحث

يُنزَّل ملف PDF الخاص بك تلقائيًا عند انتهاء التعرف على النص. يبقى المظهر الأصلي دون تغيير؛ تُضاف فقط طبقة نصية غير مرئية حتى تتمكن من البحث والتحديد ونسخ النص في أي قارئ PDF.

متى تستخدم التعرف الضوئي (OCR)

التعرف الضوئي مفيد في أي وقت يكون لديك فيه مستند كصورة وتحتاج إلى العمل مع النص بداخله:

الفئة الاستخدام النموذجي
القانون البحث في العقود القديمة ومستندات المحاكم الممسوحة ضوئيًا من الورق
الطلاب نسخ النص من الكتب الدراسية الممسوحة ضوئيًا، تظليل المقاطع، استيرادها إلى الملاحظات
المحاسبة جعل الفواتير والإيصالات الممسوحة ضوئيًا قابلة للبحث لمسارات التدقيق
الرعاية الصحية رقمنة سجلات المرضى الورقية مع الحفاظ على خصوصية الملفات — لا شيء يغادر جهازك
الباحثون جعل الأوراق الأكاديمية ووثائق الأرشيف الممسوحة ضوئيًا قابلة للبحث
الحكومة / الموارد البشرية أرشفة النماذج الورقية وتحويلها إلى سجلات رقمية قابلة للبحث

ملفات PDF النصية مقابل الممسوحة ضوئيًا — ما الفرق؟

تكتشف PDFree تلقائيًا نوع ملف PDF الذي لديك. ملفات PDF ذات الطبقة النصية (معظم ملفات PDF المُنشأة رقميًا — من Word أو مستندات Google أو أي تطبيق حديث) تحتوي بالفعل على نص قابل للقراءة آليًا مضمَّن في الملف — الاستخراج فوري ولا يلزم محرك OCR. ملفات PDF الممسوحة ضوئيًا (صور للصفحات، مستندات فاكس، مسوحات أرشيفية قديمة، تصديرات من ماسحات الهاتف) تحتوي فقط على صور وتتطلب OCR لتحويل البكسلات إلى نص قابل للتحديد والبحث.

اكتشاف اللغة التلقائي — بلا تخمين

تجبرك معظم أدوات OCR على اختيار لغة المستند مسبقًا، والاختيار الخاطئ يُفسد الدقة بصمت. تأخذ PDFree بدلًا من ذلك عينة من محتوى الصفحة وتقترح اللغة الصحيحة تلقائيًا — ميزة مميّزة حقًا، لأن محرك التعرف الأساسي يعمل بشكل مستقل عن أي من لغات موقع PDFree الـ6 التي تتصفح بها. تقرأ مسحًا ضوئيًا بالروسية أو اليابانية أو التركية أثناء استخدام الواجهة الإنجليزية؟ لا يزال الاكتشاف يجد اللغة الحقيقية للمستند. يمكنك دائمًا تجاوز الاقتراح يدويًا إذا مزجت الصفحة بين أنظمة كتابة أو كانت العينة غير حاسمة.

دعم 18 لغة

تستخدم PDFree محرك Tesseract.js، وهو محرك تعرف على النصوص رائد ومفتوح المصدر، وتدعم 18 لغة: الإنجليزية والفرنسية والألمانية والإسبانية والإيطالية والبرتغالية والروسية والأوزبكية والهولندية والبولندية والتركية (الأنظمة الأوروبية) والعربية واليابانية والصينية المبسّطة والصينية التقليدية والكورية والهندية والتايلاندية (الأنظمة المعقّدة).

ما الذي يؤثر على جودة التعرف الضوئي؟

بعد التعرف الضوئي، تعرض PDFree درجة جودة (ممتاز / جيد / مقبول / ضعيف) بناءً على درجة ثقة Tesseract بالكلمات. العوامل الرئيسية:

  • دقة المسح الضوئي — 300 DPI أو أعلى تعطي أفضل النتائج. أقل من 150 DPI، تصبح الخطوط الرفيعة والنص الصغير صعبة التعرّف عليها.
  • محاذاة الصفحة — الصفحات المائلة أو المُدارة تقلّل الدقة. تصحّح PDFree دوران PDF تلقائيًا (90°/180°/270°)، لكن الميل الفعلي للصفحة في المسح الضوئي لا يمكن تصحيحه.
  • الطباعة مقابل الخط اليدوي — النص المطبوع يُتعرَّف عليه جيدًا؛ الخط اليدوي المتصل غير مدعوم في Tesseract.
  • ضوضاء الخلفية — الخلفيات الملوّنة أو الظلال أو العلامات المائية تقلّل التباين. تحوّل PDFree الصفحات إلى تدرج رمادي قبل التعرف الضوئي لتحسين النتائج.
  • تطابق اللغة — يختار الاكتشاف التلقائي النموذج الصحيح في معظم الحالات؛ للمستندات متعددة اللغات، اختر اللغة السائدة يدويًا للحصول على أفضل النتائج.

PDF قابل للبحث مقابل نص عادي — ماذا تُنزّل؟

يحتفظ PDF القابل للبحث بصورك الممسوحة ضوئيًا الأصلية تمامًا كما كانت ويضيف طبقة نصية غير مرئية فوقها. افتحه في أي قارئ PDF ويمكنك تحديد النص، واستخدام Ctrl+F للبحث، ونسخ المحتوى — المظهر البصري لا يتغيّر. استخدم هذا للأرشفة أو المشاركة أو التخزين طويل الأمد.

يحتوي ملف ‎.txt‏ فقط على النص العادي المستخرَج مع فواصل الصفحات. استخدم هذا عندما تحتاج إلى تعديل المحتوى في Word أو مستندات Google، أو تزويد أداة أخرى بالنص، أو معالجته برمجيًا. فعّل "أيضًا تنزيل نسخة ‎.txt‏" في الخيارات للحصول على كلا الملفين معًا.

الخصوصية — مستنداتك الممسوحة ضوئيًا تبقى خاصة

غالبًا ما تحتوي المستندات الممسوحة ضوئيًا على محتوى حساس — عقود، سجلات طبية، رسائل شخصية، نماذج ضريبية. مع PDFree، لا شيء يُرفع أبدًا. يُنزَّل محرك OCR (Tesseract.js) مرة واحدة ثم يعمل بالكامل داخل علامة تبويب متصفحك. لا توجد خوادم تستقبل ملفاتك، ولا تخزين سحابي، ولا أي نوع من جمع البيانات. افتح أدوات المطوّر → تبويب Network أثناء المعالجة للتحقق بنفسك: صفر عمليات رفع ملفات.

استخدام PDFree OCR دون اتصال بالإنترنت

بمجرد تنزيل محرك Tesseract.js في أول تشغيل للتعرف الضوئي (حوالي 17 ميجابايت، يُخزَّن مؤقتًا بواسطة متصفحك)، يعمل PDFree OCR دون اتصال بالإنترنت بالكامل. لا حاجة إلى اتصال إنترنت لمعالجة المستندات اللاحقة. هذا يجعله مناسبًا للبيئات ذات الوصول المحدود للشبكة — المكاتب القانونية، المرافق الطبية، مراجعة المستندات السرية، أو أي مكان لا يمكنك فيه إرسال الملفات إلى خادم خارجي. يخزّن Service Worker غلاف التطبيق مؤقتًا، لذا حتى الواجهة نفسها تُحمَّل دون اتصال بعد الزيارة الأولى.

PDFree OCR مقابل أدوات OCR النموذجية عبر الإنترنت

الميزة PDFree OCR النموذجي عبر الإنترنت
معالجة الملف في متصفحك — محلي فقط يُرفع الملف إلى خادم
اختيار اللغة يُكتشَف تلقائيًا من المستند يدوي، سهل الاختيار الخاطئ
الحاجة إلى حساب لا غالبًا مطلوب
الناتج PDF قابل للبحث + ‎.txt‏ اختياري ‎.txt‏ فقط في العديد من الأدوات
التخطيط الأصلي محفوظ بدقة غالبًا يُعاد تنسيقه
يعمل دون اتصال نعم، بعد التحميل الأول لا

كيفية تحويل PDF ممسوح ضوئيًا إلى نص قابل للتحرير

لتحويل PDF ممسوح ضوئيًا إلى نص قابل للتحرير، استخدم PDFree على خطوتين: شغّل أولًا التعرف الضوئي لإنشاء PDF قابل للبحث (أعلاه)، ثم افتح النتيجة في PDF إلى Word — تحوّل الأداة الطبقة النصية المضمَّنة إلى ملف ‎.docx‏ قابل للتحرير بالكامل. تعمل العملية بأكملها محليًا؛ لا يُرفع مستندك أبدًا إلى أي مكان. للحصول على ناتج نصي بسيط، فعّل مربع "أيضًا تنزيل نسخة ‎.txt‏" أثناء التعرف الضوئي وتخطَّ تحويل Word تمامًا.

الأسئلة الشائعة

هل أداة التعرف الضوئي هذه مجانية حقًا؟

نعم، مجانية بالكامل. بلا اشتراك، بلا خطة متميّزة، بلا رسوم لكل ملف. محرك OCR (Tesseract.js) مفتوح المصدر ويعمل بالكامل في متصفحك.

هل تُخزّن PDFree أو تسجّل ملفاتي بعد المعالجة؟

لا. لا يوجد لدى PDFree خادم خلفي يستقبل ملفاتك، لذا لا يمكن تخزين أو تسجيل أو الاحتفاظ بأي شيء. يوجد ملف PDF الخاص بك والنص المُتعرَّف عليه فقط في ذاكرة المتصفح طوال الجلسة، ويُمسحان عند إغلاق علامة التبويب.

هل يُرفع ملفي إلى خادم؟

أبدًا. تحدث كل المعالجة داخل علامة تبويب متصفحك. ملف PDF الخاص بك لا يغادر جهازك أبدًا — لا يستقبله أي خادم أبدًا. يُنزَّل محرك Tesseract.js من شبكة توصيل محتوى مرة واحدة ويُخزَّن مؤقتًا؛ بعد ذلك يعمل دون اتصال بالكامل.

كيف يعمل اكتشاف اللغة التلقائي؟

تأخذ PDFree عينة نصية من صفحاتك الممسوحة ضوئيًا وتقترح اللغة الأكثر احتمالًا للمستند قبل تشغيل التعرف الضوئي — لست بحاجة لمعرفتها مسبقًا. يعمل هذا بشكل مستقل عن لغة واجهة الموقع، لذا يُكتشَف مسح ضوئي بالإسبانية بشكل صحيح حتى لو كنت تتصفح PDFree بالإنجليزية. يمكنك دائمًا تجاوز الاقتراح من القائمة المنسدلة.

ما اللغات المدعومة؟

18 لغة: الإنجليزية والفرنسية والألمانية والإسبانية والإيطالية والبرتغالية والروسية والأوزبكية والهولندية والبولندية والتركية والعربية واليابانية والصينية (المبسّطة) والصينية (التقليدية) والكورية والهندية والتايلاندية.

هل سيبدو ملف PDF مختلفًا بعد التعرف الضوئي؟

لا. تضيف PDFree طبقة نصية غير مرئية فوق صفحاتك الممسوحة ضوئيًا الأصلية. المظهر لا يتغيّر — تبقى الصور والتخطيط والتنسيق كما كانت تمامًا. تكسب القدرة على البحث والتحديد ونسخ النص في أي قارئ PDF.

لماذا جودة التعرف الضوئي لدي مصنّفة كضعيفة أو مقبولة؟

تعتمد دقة التعرف الضوئي على جودة المسح الأصلي. الدقة المنخفضة (أقل من 150)، الصفحات الضبابية أو المائلة، الخلفيات الملوّنة، والنص المكتوب بخط اليد كلها تقلّل درجات الثقة. للحصول على أفضل النتائج: امسح ضوئيًا بدقة 300 DPI أو أعلى، بإضاءة جيدة، ومحاذاة مستقيمة، ودع الاكتشاف التلقائي يختار (أو يؤكد) اللغة الصحيحة.

ما الفرق بين PDF قابل للبحث وملف ‎.txt‏؟

يحتفظ PDF القابل للبحث بصورك الممسوحة ضوئيًا الأصلية ويضيف طبقة نصية غير مرئية فوقها — مفيد للأرشفة والبحث داخل قارئ PDF أو المشاركة. يحتوي ملف ‎.txt‏ فقط على النص العادي المستخرَج مع فواصل الصفحات — مفيد للتحرير في Word أو الاستيراد إلى أدوات أخرى أو نسخ المحتوى. نزّل كليهما معًا بتفعيل مربع "أيضًا تنزيل نسخة ‎.txt‏".

ما حد حجم الملف؟

تدعم PDFree OCR ملفات حتى 200 ميجابايت. على الجوّال (iOS/iPadOS)، تقتصر المعالجة على أول 30 صفحة لمنع مشاكل الذاكرة — قسّم ملف PDF أولًا لمعالجة الباقي. لا توجد حدود على متصفحات سطح المكتب.

هل يعمل دون اتصال بالإنترنت؟

نعم. بمجرد تنزيل محرك Tesseract.js في أول تشغيل للتعرف الضوئي، تعمل PDFree دون اتصال بالكامل كتطبيق ويب تقدّمي (PWA) — لا حاجة إلى اتصال إنترنت لمعالجة المزيد من المستندات.

أدوات ذات صلة

لماذا تختار PDFree على أدوات PDF الأخرى؟

📁
بدون حدود لحجم الملفات ادمج أو اضغط أو حوّل ملفات PDF بأي حجم — بدون حد عند 500 ميجابايت أو 1 جيجابايت أو أكثر.
🔒
الملفات لا تغادر جهازك أبدًا كل شيء يعمل داخل متصفحك. بدون رفع، بدون خوادم، بدون تسريب بيانات — يعمل أيضًا دون اتصال.
👤
بدون حاجة لإنشاء حساب بدون تسجيل، بدون بريد إلكتروني، بدون تسجيل دخول. افتح الصفحة واستخدم الأداة — بهذه البساطة.
🚫
بدون إضافة علامات مائية الملفات الناتجة نظيفة. بدون علامات تجارية، بدون أختام مائية، بدون طبقات نص مخفية.
♾️
بدون حد يومي استخدمه بقدر ما تحتاج. بدون حصص يومية، بدون حدود شهرية، بدون ترويج للترقية المدفوعة.
🆓
مجاني إلى الأبد بدون فترة تجريبية، بدون مستويات مدفوعة. PDFree مجاني تمامًا — مفتوح المصدر بموجب رخصة AGPLv3.