PDF إلى Markdown
حوّل نص PDF وعناوينه وقوائمه إلى Markdown — يعمل في متصفحك، بدون رفع.
حوّل نص PDF وعناوينه وقوائمه إلى Markdown — يعمل في متصفحك، بدون رفع.
تحتاج إلى Markdown نظيف من ملف PDF للصقه في ChatGPT أو Claude أو مسار RAG؟ تقرأ PDFree نص ملف PDF الخاص بك وتكتشف تلقائيًا العناوين والقوائم النقطية والقوائم المرقّمة وتنسيق النص الغامق/المائل والجداول والصور والصيغ الرياضية — ثم تُصدِر ملف .md نصي بسيط (أو ملف .zip مع الصور/الصيغ إن وُجدت). كل شيء يعمل في متصفحك. لا يُرفع مستندك أبدًا إلى أي خادم — ولا حتى خوادم PDFree نفسها — وهذا مهم إذا كان ما تُقدّمه لأداة ذكاء اصطناعي محتوى داخليًا أو غير منشور أو لا تريد مروره عبر طرف ثالث أولًا.
تكتشف هذه الأداة النص والعناوين والقوائم والجداول والأشكال/الصور والصيغ الرياضية المضمَّنة أو المستقلة — يصبح التنزيل ملف .zip يحتوي على document.md ومجلد صور كلما احتوى ملف PDF على صور قابلة للاستخراج أو صيغ مقصوصة، أو ملف .md بسيطًا عندما لا يحتوي على ذلك. راجع PDF إلى Excel لاستخراج جداول أكثر موثوقية، أو PDF إلى Word لمستند قابل للتحرير بالكامل. آخر تحقق: أغسطس 2026.
انقر على اختر ملفًا أو اسحب ملف PDF إلى منطقة الإسقاط. تقرأ PDFree عدد الصفحات فورًا.
يصبح النص الأكبر عناوين #/##/###، وتصبح الأسطر ذات النقاط أو الأرقام صيغة قوائم Markdown، ويُحفَظ النص الغامق والمائل.
انقر على تحويل إلى Markdown. يُنزَّل ملف .md نصي بسيط فورًا.
استورد تقرير أو مقالة PDF إلى Obsidian أو Logseq أو ويكي الفريق كـ Markdown نظيف وقابل للتحرير بدلًا من نسخ ولصق النص المنسَّق.
حوّل مواصفات أو وثيقة متطلبات أو مستند تصميم مُصدَّر بصيغة PDF إلى نقطة بداية لملف README أو صفحة توثيق.
تستهلك Jekyll وHugo ومولّدات المواقع الثابتة الأخرى Markdown مباشرة — هذا يتخطى إعادة التنسيق اليدوية عند نقل محتوى PDF إلى موقع.
تمنح بنية Markdown الخفيفة (العناوين، القوائم، الجداول الحقيقية) نموذج اللغة حدود تجزئة وترتيب قراءة صحيحين — بخلاف تفريغ نص PDF الخام، لأن PDF يخزّن مواضع الرموز لا بنية المستند. تُحفَظ الصيغ الرياضية مضمَّنة كـ $...$ حيثما يمكن تسويتها بشكل صحيح، أو تُقصّ كصورة موسومة حيث لا يمكن ذلك (المصفوفات، الكسور المتراكبة) — لذا لا يتحوّل شيء إلى نص مضلِّل وخاطئ بصمت.
تُكتشَف العناوين والفقرات والقوائم النقطية والمرقّمة والجداول والأشكال والصيغ الرياضية تلقائيًا وتُحوَّل إلى صيغة Markdown — تأتي الأشكال والصيغ المقصوصة مع صورها في ملف .zip، وكل واحدة منها مع نص بديل وصفي. للجداول المعقّدة، جرّب PDF إلى Excel؛ ولمستند قابل للتحرير بالكامل، جرّب PDF إلى Word.
لا يحتوي PDF داخليًا على مفهوم حقيقي لـ"فقرة" أو "جدول" — إنه رموز مُوضَعة على صفحة. غالبًا ما يؤدي استخراج النص الخام من PDF إلى دمج الأعمدة بشكل خاطئ، ودمج الحواشي مع النص الأساسي، وتحويل الجداول إلى جدار من الأرقام غير المحاذاة. لا شيء من ذلك يساعد نموذج اللغة، بل يضرّ فعليًا بجودة الاسترجاع في مسار RAG، حيث تعتمد حدود التجزئة على بنية لم تكن موجودة أصلًا في الصيغة المصدر.
تكتشف أداة PDF إلى Markdown من PDFree تلك البنية مباشرة من حجم الخط والموضع والتخطيط — عناوين #/## حقيقية (لا مجرد نص أكبر)، وجداول Markdown بنمط GitHub (لا صفوف مسطَّحة)، وصيغ رياضية موسومة كـ $...$ أو مقصوصة كصورة مع الاحتفاظ بالنص المسطَّح كنص بديل — بحيث يحصل المستهلك النصي البحت على إشارة، ويقرأ النموذج القادر على الرؤية الصورة بشكل صحيح. يحدث كل شيء محليًا، لذا فإن المستندات التي تفضّل عدم رفعها لطرف ثالث — التقارير الداخلية، المسودات، الأبحاث غير المنشورة — لا تحتاج أبدًا لمغادرة جهازك فقط للحصول على تنسيق جاهز للذكاء الاصطناعي. قِسنا جودة الإخراج الفعلية مقابل pymupdf4llm وDocling وMarker على 7 مستندات حقيقية — 91.6/100، بفارق 1.1 نقطة فقط عن Docling. تحتاج هذا في سكريبت أو مسار عمل بدلًا من علامة تبويب متصفح؟ يعمل المحرك نفسه أيضًا كأداة CLI/مكتبة npm أو واجهة REST API مستضافة ذاتيًا عبر Docker — نفس المعالجة المحلية فقط، بدون رفع، لكن على جهازك الخاص.
ترفع معظم أدوات تحويل PDF إلى Markdown عبر الإنترنت مستندك إلى خادم بعيد لاستخراج النص وإرسال ملف مرة أخرى. أيًا كان ما في ملف PDF — ملاحظات داخلية، مسودة، بحث خاص — يستقر لفترة وجيزة على أجهزة لا تملكها.
تعمل PDFree بشكل مختلف. تُقرَأ كل صفحة وتُبنَى بنيتها إلى Markdown داخل متصفحك باستخدام مكتبة pdf.js مفتوحة المصدر — لا حاجة حتى لمكتبة أخرى، لأن Markdown مجرد نص. لا يغادر ملف PDF الخاص بك جهازك أبدًا. لا يستقبله أي خادم — ولا حتى خوادم PDFree نفسها.
| الميزة | PDFree | الأدوات السحابية المعتادة |
|---|---|---|
| وجهة بياناتك | تبقى على جهازك | تُرفع إلى خوادم بعيدة |
| اكتشاف العناوين والقوائم | نعم، تلقائيًا | يختلف، غالبًا نص بسيط فقط |
| الحاجة إلى التسجيل | لا | عادةً مطلوب |
| حد الاستخدام اليومي | لا يوجد | غالبًا مقيَّد في الخطة المجانية |
| السعر | مجاني للأبد | مجاني بحدود / خطط مدفوعة |
لا. تُقرَأ النصوص وتُبنَى بنيتها إلى Markdown بالكامل داخل متصفحك باستخدام pdf.js. لا يغادر ملف PDF الخاص بك جهازك أبدًا.
لا. تعمل PDFree بالكامل داخل متصفحك — لا يوجد خادم خلفي يستقبل ملفاتك. بما أنه لا يُرفع أي شيء، فمن المستحيل تخزينه أو تسجيله أو الاحتفاظ به. يوجد مستندك فقط في ذاكرة المتصفح طوال مدة الجلسة، ويُمسح عند إغلاق علامة التبويب.
تُكتشَف الجداول تلقائيًا وتُحوَّل إلى صيغة جدول Markdown بنمط GitHub. تُستخرَج الصور/الأشكال أيضًا، وتُوسَم الصيغ الرياضية كـ $...$ حيثما يمكن تسويتها بشكل صحيح، أو تُقصّ كصورة موسومة (مع الاحتفاظ بالنص المسطَّح كنص بديل) حيث لا يمكن ذلك — يصبح التنزيل ملف .zip (document.md + مجلد صور) كلما احتوى ملف PDF على صور قابلة للاستخراج أو صيغ مقصوصة، أو ملف .md بسيطًا عندما لا يحتوي على ذلك. إذا احتجت استخراج جداول أكثر موثوقية، استخدم PDF إلى Excel؛ ولمستند قابل للتحرير بالكامل، استخدم PDF إلى Word.
لا. يقوم هذا المفتاح الاختياري بتنزيل نموذج ذكاء اصطناعي لمرة واحدة بحجم حوالي 76 ميجابايت (Texo/FormulaNet) من شبكة توصيل محتوى Hugging Face، حتى يعمل التعرف على الصيغ محليًا في متصفحك — وهو نفس نوع التنزيل لمرة واحدة الذي تقوم به PDFree بالفعل لمكتبة pdf.js نفسها. لا يكون ملف PDF الخاص بك جزءًا من ذلك التنزيل أبدًا ولا يُرفع إلى أي مكان؛ فقط ملفات النموذج نفسه تنتقل في الاتجاه المعاكس، من شبكة التوصيل إلى متصفحك. الميزة مُعطَّلة افتراضيًا، وكل صيغة يتعرّف عليها تُوسَم بوضوح على أنها من إنتاج الذكاء الاصطناعي حتى تتمكن من التحقق منها — الصيغ التي لا يمكنه قراءتها بثقة تعود إلى طريقة القص بالصورة الموجودة أصلًا.
تقارن PDFree حجم خط كل سطر بحجم النص الأساسي المعتاد للمستند. يصبح النص الأكبر بشكل ملحوظ عنوان Markdown (# أو ## أو ### حسب مقدار الفرق).
تُحوَّل الأسطر ذات النقاط (•، ◦، ▪ وعلامات مشابهة) والأسطر المرقّمة ("1."، "2)") إلى صيغة قوائم Markdown. تُترَك قوائم الحروف أو الأرقام الرومانية (a.، iv.) كنص بسيط، لأن تلك العلامات يسهل الخلط بينها وبين المحتوى الحقيقي.
نعم. PDFree مجانية بالكامل — بلا تسجيل، بلا حساب، بلا تثبيت. افتح الأداة، حمّل ملف PDF، ونزّل ملف .md.
فقط إذا كان ملف PDF يحتوي بالفعل على طبقة نصية. ملفات PDF الممسوحة ضوئيًا والقائمة على الصور فقط لا تحتوي على نص قابل للاستخراج — شغّل التعرف الضوئي على PDF (OCR) أولًا، ثم حوّل النتيجة.
نعم. يمنح Markdown نموذج اللغة بنية حقيقية — عناوين، قوائم، جداول بنمط GitHub — بدلًا من تفريغ نص PDF مسطَّح، مما يحسّن دقة قراءة النموذج للمحتوى وطريقة تجزئة مسار RAG له. تُحفَظ الصيغ الرياضية كـ $...$ أو صورة موسومة بدلًا من التحوّل بصمت إلى نص مشوَّش، والتحويل المحلي يعني أن محتوى المستند لا يحتاج أبدًا لمغادرة جهازك فقط لإعادة تنسيقه — مفيد للمواد الداخلية أو غير المنشورة التي تقدّمها لـ ChatGPT أو Claude أو مسارك الخاص. اكتشاف الجداول والصيغ قائم على الاستدلال، لذا قد تفقد التخطيطات الكثيفة أو المعقّدة بشكل غير معتاد بعض البنية — تحقّق من الناتج قبل الاعتماد عليه لمستند كثيف الجداول أو الصيغ.