التعرف الضوئي على PDF
استخرج النص من ملفات PDF الممسوحة ضوئيًا واجعلها قابلة للبحث. يكتشف لغة المستند تلقائيًا. محلي 100% — لا شيء يُرفع.
استخرج النص من ملفات PDF الممسوحة ضوئيًا واجعلها قابلة للبحث. يكتشف لغة المستند تلقائيًا. محلي 100% — لا شيء يُرفع.
استخرج النص من ملفات PDF الممسوحة ضوئيًا، اجعلها قابلة للبحث، وانسخ المحتوى — مباشرة في متصفحك باستخدام التعرف الضوئي على الحروف (OCR). بدون برامج للتثبيت، بدون حاجة لحساب، وملفاتك لا تغادر جهازك أبدًا.
تكتشف PDFree تلقائيًا لغة مستندك قبل تشغيل التعرف الضوئي، حتى لا تحتاج إلى التخمين — تعمل على العقود الممسوحة ضوئيًا والكتب الدراسية والفواتير ووثائق الأرشيف بعشرات اللغات وأنظمة الكتابة.
اسحب وأفلت الملف أو انقر على اختر PDF. تكتشف PDFree تلقائيًا ما إذا كان ملف PDF لديك يحتوي بالفعل على طبقة نصية أو أنه صورة ممسوحة ضوئيًا بحتة.
لملفات PDF الممسوحة ضوئيًا: انقر على تثبيت محرك OCR لتحميل Tesseract.js (حوالي 17 ميجابايت، تنزيل لمرة واحدة). تأخذ PDFree عينة من الصفحة وتقترح لغة المستند تلقائيًا؛ يمكنك تجاوزها من القائمة المنسدلة عند الحاجة. تتخطى ملفات PDF ذات الطبقة النصية هذه الخطوة بالكامل.
يعالج محرك التعرف على النص كل صفحة محليًا — لا شيء يُرفع. يعرض شريط تقدّم الوقت المتبقي المتوقّع.
يُنزَّل ملف PDF الخاص بك تلقائيًا عند انتهاء التعرف على النص. يبقى المظهر الأصلي دون تغيير؛ تُضاف فقط طبقة نصية غير مرئية حتى تتمكن من البحث والتحديد ونسخ النص في أي قارئ PDF.
التعرف الضوئي مفيد في أي وقت يكون لديك فيه مستند كصورة وتحتاج إلى العمل مع النص بداخله:
| الفئة | الاستخدام النموذجي |
|---|---|
| القانون | البحث في العقود القديمة ومستندات المحاكم الممسوحة ضوئيًا من الورق |
| الطلاب | نسخ النص من الكتب الدراسية الممسوحة ضوئيًا، تظليل المقاطع، استيرادها إلى الملاحظات |
| المحاسبة | جعل الفواتير والإيصالات الممسوحة ضوئيًا قابلة للبحث لمسارات التدقيق |
| الرعاية الصحية | رقمنة سجلات المرضى الورقية مع الحفاظ على خصوصية الملفات — لا شيء يغادر جهازك |
| الباحثون | جعل الأوراق الأكاديمية ووثائق الأرشيف الممسوحة ضوئيًا قابلة للبحث |
| الحكومة / الموارد البشرية | أرشفة النماذج الورقية وتحويلها إلى سجلات رقمية قابلة للبحث |
تكتشف PDFree تلقائيًا نوع ملف PDF الذي لديك. ملفات PDF ذات الطبقة النصية (معظم ملفات PDF المُنشأة رقميًا — من Word أو مستندات Google أو أي تطبيق حديث) تحتوي بالفعل على نص قابل للقراءة آليًا مضمَّن في الملف — الاستخراج فوري ولا يلزم محرك OCR. ملفات PDF الممسوحة ضوئيًا (صور للصفحات، مستندات فاكس، مسوحات أرشيفية قديمة، تصديرات من ماسحات الهاتف) تحتوي فقط على صور وتتطلب OCR لتحويل البكسلات إلى نص قابل للتحديد والبحث.
تجبرك معظم أدوات OCR على اختيار لغة المستند مسبقًا، والاختيار الخاطئ يُفسد الدقة بصمت. تأخذ PDFree بدلًا من ذلك عينة من محتوى الصفحة وتقترح اللغة الصحيحة تلقائيًا — ميزة مميّزة حقًا، لأن محرك التعرف الأساسي يعمل بشكل مستقل عن أي من لغات موقع PDFree الـ6 التي تتصفح بها. تقرأ مسحًا ضوئيًا بالروسية أو اليابانية أو التركية أثناء استخدام الواجهة الإنجليزية؟ لا يزال الاكتشاف يجد اللغة الحقيقية للمستند. يمكنك دائمًا تجاوز الاقتراح يدويًا إذا مزجت الصفحة بين أنظمة كتابة أو كانت العينة غير حاسمة.
تستخدم PDFree محرك Tesseract.js، وهو محرك تعرف على النصوص رائد ومفتوح المصدر، وتدعم 18 لغة: الإنجليزية والفرنسية والألمانية والإسبانية والإيطالية والبرتغالية والروسية والأوزبكية والهولندية والبولندية والتركية (الأنظمة الأوروبية) والعربية واليابانية والصينية المبسّطة والصينية التقليدية والكورية والهندية والتايلاندية (الأنظمة المعقّدة).
بعد التعرف الضوئي، تعرض PDFree درجة جودة (ممتاز / جيد / مقبول / ضعيف) بناءً على درجة ثقة Tesseract بالكلمات. العوامل الرئيسية:
يحتفظ PDF القابل للبحث بصورك الممسوحة ضوئيًا الأصلية تمامًا كما كانت ويضيف طبقة نصية غير مرئية فوقها. افتحه في أي قارئ PDF ويمكنك تحديد النص، واستخدام Ctrl+F للبحث، ونسخ المحتوى — المظهر البصري لا يتغيّر. استخدم هذا للأرشفة أو المشاركة أو التخزين طويل الأمد.
يحتوي ملف .txt فقط على النص العادي المستخرَج مع فواصل الصفحات. استخدم هذا عندما تحتاج إلى تعديل المحتوى في Word أو مستندات Google، أو تزويد أداة أخرى بالنص، أو معالجته برمجيًا. فعّل "أيضًا تنزيل نسخة .txt" في الخيارات للحصول على كلا الملفين معًا.
غالبًا ما تحتوي المستندات الممسوحة ضوئيًا على محتوى حساس — عقود، سجلات طبية، رسائل شخصية، نماذج ضريبية. مع PDFree، لا شيء يُرفع أبدًا. يُنزَّل محرك OCR (Tesseract.js) مرة واحدة ثم يعمل بالكامل داخل علامة تبويب متصفحك. لا توجد خوادم تستقبل ملفاتك، ولا تخزين سحابي، ولا أي نوع من جمع البيانات. افتح أدوات المطوّر → تبويب Network أثناء المعالجة للتحقق بنفسك: صفر عمليات رفع ملفات.
بمجرد تنزيل محرك Tesseract.js في أول تشغيل للتعرف الضوئي (حوالي 17 ميجابايت، يُخزَّن مؤقتًا بواسطة متصفحك)، يعمل PDFree OCR دون اتصال بالإنترنت بالكامل. لا حاجة إلى اتصال إنترنت لمعالجة المستندات اللاحقة. هذا يجعله مناسبًا للبيئات ذات الوصول المحدود للشبكة — المكاتب القانونية، المرافق الطبية، مراجعة المستندات السرية، أو أي مكان لا يمكنك فيه إرسال الملفات إلى خادم خارجي. يخزّن Service Worker غلاف التطبيق مؤقتًا، لذا حتى الواجهة نفسها تُحمَّل دون اتصال بعد الزيارة الأولى.
| الميزة | PDFree | OCR النموذجي عبر الإنترنت |
|---|---|---|
| معالجة الملف | في متصفحك — محلي فقط | يُرفع الملف إلى خادم |
| اختيار اللغة | يُكتشَف تلقائيًا من المستند | يدوي، سهل الاختيار الخاطئ |
| الحاجة إلى حساب | لا | غالبًا مطلوب |
| الناتج | PDF قابل للبحث + .txt اختياري | .txt فقط في العديد من الأدوات |
| التخطيط الأصلي | محفوظ بدقة | غالبًا يُعاد تنسيقه |
| يعمل دون اتصال | نعم، بعد التحميل الأول | لا |
لتحويل PDF ممسوح ضوئيًا إلى نص قابل للتحرير، استخدم PDFree على خطوتين: شغّل أولًا التعرف الضوئي لإنشاء PDF قابل للبحث (أعلاه)، ثم افتح النتيجة في PDF إلى Word — تحوّل الأداة الطبقة النصية المضمَّنة إلى ملف .docx قابل للتحرير بالكامل. تعمل العملية بأكملها محليًا؛ لا يُرفع مستندك أبدًا إلى أي مكان. للحصول على ناتج نصي بسيط، فعّل مربع "أيضًا تنزيل نسخة .txt" أثناء التعرف الضوئي وتخطَّ تحويل Word تمامًا.
نعم، مجانية بالكامل. بلا اشتراك، بلا خطة متميّزة، بلا رسوم لكل ملف. محرك OCR (Tesseract.js) مفتوح المصدر ويعمل بالكامل في متصفحك.
لا. لا يوجد لدى PDFree خادم خلفي يستقبل ملفاتك، لذا لا يمكن تخزين أو تسجيل أو الاحتفاظ بأي شيء. يوجد ملف PDF الخاص بك والنص المُتعرَّف عليه فقط في ذاكرة المتصفح طوال الجلسة، ويُمسحان عند إغلاق علامة التبويب.
أبدًا. تحدث كل المعالجة داخل علامة تبويب متصفحك. ملف PDF الخاص بك لا يغادر جهازك أبدًا — لا يستقبله أي خادم أبدًا. يُنزَّل محرك Tesseract.js من شبكة توصيل محتوى مرة واحدة ويُخزَّن مؤقتًا؛ بعد ذلك يعمل دون اتصال بالكامل.
تأخذ PDFree عينة نصية من صفحاتك الممسوحة ضوئيًا وتقترح اللغة الأكثر احتمالًا للمستند قبل تشغيل التعرف الضوئي — لست بحاجة لمعرفتها مسبقًا. يعمل هذا بشكل مستقل عن لغة واجهة الموقع، لذا يُكتشَف مسح ضوئي بالإسبانية بشكل صحيح حتى لو كنت تتصفح PDFree بالإنجليزية. يمكنك دائمًا تجاوز الاقتراح من القائمة المنسدلة.
18 لغة: الإنجليزية والفرنسية والألمانية والإسبانية والإيطالية والبرتغالية والروسية والأوزبكية والهولندية والبولندية والتركية والعربية واليابانية والصينية (المبسّطة) والصينية (التقليدية) والكورية والهندية والتايلاندية.
لا. تضيف PDFree طبقة نصية غير مرئية فوق صفحاتك الممسوحة ضوئيًا الأصلية. المظهر لا يتغيّر — تبقى الصور والتخطيط والتنسيق كما كانت تمامًا. تكسب القدرة على البحث والتحديد ونسخ النص في أي قارئ PDF.
تعتمد دقة التعرف الضوئي على جودة المسح الأصلي. الدقة المنخفضة (أقل من 150)، الصفحات الضبابية أو المائلة، الخلفيات الملوّنة، والنص المكتوب بخط اليد كلها تقلّل درجات الثقة. للحصول على أفضل النتائج: امسح ضوئيًا بدقة 300 DPI أو أعلى، بإضاءة جيدة، ومحاذاة مستقيمة، ودع الاكتشاف التلقائي يختار (أو يؤكد) اللغة الصحيحة.
يحتفظ PDF القابل للبحث بصورك الممسوحة ضوئيًا الأصلية ويضيف طبقة نصية غير مرئية فوقها — مفيد للأرشفة والبحث داخل قارئ PDF أو المشاركة. يحتوي ملف .txt فقط على النص العادي المستخرَج مع فواصل الصفحات — مفيد للتحرير في Word أو الاستيراد إلى أدوات أخرى أو نسخ المحتوى. نزّل كليهما معًا بتفعيل مربع "أيضًا تنزيل نسخة .txt".
تدعم PDFree OCR ملفات حتى 200 ميجابايت. على الجوّال (iOS/iPadOS)، تقتصر المعالجة على أول 30 صفحة لمنع مشاكل الذاكرة — قسّم ملف PDF أولًا لمعالجة الباقي. لا توجد حدود على متصفحات سطح المكتب.
نعم. بمجرد تنزيل محرك Tesseract.js في أول تشغيل للتعرف الضوئي، تعمل PDFree دون اتصال بالكامل كتطبيق ويب تقدّمي (PWA) — لا حاجة إلى اتصال إنترنت لمعالجة المزيد من المستندات.