مجانًا — مع OCR

تحويل PDF إلى Markdown مجانًا، حتى الملفات الممسوحة

أمام ملف PDF ممسوح ضوئيًا تستسلم معظم أدوات التحويل. هذه الأداة تتعرّف عليه وتشغّل OCR، فتخرج التقارير والعقود والنماذج بصيغة Markdown حقيقية، بجداولها وعناوينها ومعادلاتها.

أفلت ملف PDF هنا، أو انقر للاختيار

حتى 10 ميغابايت و30 صفحة · سجّل الدخول لرفع الحد

ما معنى تحويل PDF إلى Markdown؟

تحويل PDF إلى Markdown يعني استخراج النص والبنية المحبوسين داخل الملف وإعادة كتابتهما كنص عادي: العناوين تصير أسطرًا تبدأ بعلامة #، والجداول تصير جداول بخطوط عمودية، والصور تنتقل مع المستند. الجزء الصعب أن نسبة كبيرة من ملفات PDF هي في الحقيقة نسخ ممسوحة ضوئيًا بلا طبقة نص إطلاقًا، فلا يخرج الاستخراج بشيء ولا ينفع سوى OCR. تتعرّف هذه الأداة تلقائيًا على نوع ملفك. وبعد أن يصير المحتوى Markdown يمكنك المتابعة إلى Word (.docx) أو PDF أو HTML.

ثلاث طرق للانتقال من PDF إلى Markdown

1

أدوات التحويل عبر الإنترنت — ترفع الملف فيصلك Markdown خلال ثوانٍ. الخيار الأفضل حين تريد الحفاظ على البنية دون تثبيت أي شيء، وهو الطريق العملي الوحيد للملفات الممسوحة التي تحتاج OCR.

2

سطر الأوامر — مكتبات مثل pymupdf4llm أو marker تعمل محليًا ويمكن كتابة سكربتات للمعالجة بالجملة. مناسبة للمطوّرين الذين يتعاملون مع ملفات كثيرة، مقابل التثبيت والضبط، ودون OCR جاهز.

3

النسخ واللصق — تحديد النص في قارئ PDF ولصقه في محرر. يكفي لفقرة واحدة، لكن العناوين والجداول والتنسيق متعدد الأعمدة ينهار، والصفحات الممسوحة لا تعطي شيئًا على الإطلاق.

Example Output

كيف تبدو النتيجة فعليًا

أربعة أمور تتقنها هذه الأداة ولن يبلغها النسخ واللصق أبدًا.

العناوين والبنية تصمد

مستويات العناوين والقوائم المتداخلة وفواصل الفقرات تُعاد بناؤها بصيغة Markdown حقيقية، فيصير المستند جاهزًا للتحرير أو النشر بدل أن يكون كتلة نص واحدة.

نظرة عامة على مشروع من ملف PDF محوّلة إلى Markdown منظّم مع الحفاظ على مستويات العناوين والقوائم المتداخلة

الجداول تصير جداول Markdown

الجداول ذات الإطارات يُعاد بناؤها بخطوط عمودية وأعمدة مصطفّة، فتبقى التقارير والمواصفات والمقارنات صالحة لإعادة الاستخدام بدل أن تتفكك إلى نص متناثر.

جدول مبيعات من ملف PDF محوّل إلى جدول Markdown بأعمدة مصطفّة

الصفحات الممسوحة يقرأها OCR

حين لا تكون في الملف طبقة نص، يقرأ OCR صور الصفحات بدلًا من ذلك: النسخ الممسوحة والمستندات المصوّرة والنماذج، بأكثر من 170 لغة، من بينها الصينية واليابانية والكورية.

تقرير ورقي ممسوح ضوئيًا جرى التعرّف عليه بـ OCR وتحويله إلى Markdown قابل للتحرير

المعادلات تعود بصيغة LaTeX

مرّر ورقة معادلات عبر OCR فتعود الرياضيات بصيغة LaTeX حقيقية داخل كتل $$: الكسور والجذور والتكاملات والأسس تحتفظ ببنيتها، جاهزة للصقها في Obsidian أو Notion أو بحث علمي. (في ملفات PDF الرقمية تُخزَّن المعادلات كرموز متفرّقة، لذا فإن OCR هو الطريق الذي يستعيدها كما ينبغي.)

ورقة معادلات من ملف PDF محوّلة عبر OCR إلى Markdown بمعادلات LaTeX داخل كتل بعلامة الدولار

دليل كامل: تحويل PDF إلى Markdown

لماذا تمرّ بعض ملفات PDF بسلاسة بينما تحتاج أخرى إلى OCR — وكيف تحصل على أنظف نتيجة في الحالتين.

ملفات PDF الرقمية والممسوحة ضوئيًا

PDF رقمي — فيه طبقة نص

أنشأه برنامج (Word أو LaTeX أو نافذة الطباعة في المتصفح). الحروف موجودة فعلًا داخل الملف، فيكون الاستخراج سريعًا وبلا فقد يُذكر. ينطبق ذلك على نحو 97 % من مستندات كل يوم، ولا يستغرق سوى ثوانٍ.

PDF ممسوح ضوئيًا — مجرد صور للصفحات

خرج من آلة نسخ أو كاميرا هاتف أو فاكس. لا يوجد نص لاستخراجه، والتحديد والنسخ لا يعطيان شيئًا. لا يقرأها سوى OCR، ولهذا السبب بالذات تعيد أغلب الأدوات المجانية ملفًا فارغًا دون أن تنبّهك.

مقارنة جنبًا إلى جنب بين ملف PDF رقمي وآخر ممسوح ضوئيًا، مع بيان أيهما يحتاج OCR

ما الذي يخرج جيدًا

المستندات بعمود واحد

التقارير والتوثيق والأبحاث والعقود تمرّ نظيفة: العناوين تحتفظ بمستواها والقوائم تبقى متداخلة.

الجداول ذات الإطارات

الجداول التي تظهر خطوطها يُعاد بناؤها كجداول Markdown تُعرض بشكل صحيح في أي مكان.

الصور المضمّنة

الصور داخل الملف تُستخرج ويُشار إليها في النص، حتى لا يضيع شيء من المستند.

النسخ الممسوحة والنماذج

الصفحات بلا طبقة نص يتعرّف عليها OCR، بما في ذلك التنسيقات متعددة اللغات والنماذج المعبّأة.

كيف تحصل على أنظف نتيجة

  1. 1.

    دع الكشف التلقائي يقرّر أولًا

    ارفع الملف كما هو. تتحقق الأداة من وجود طبقة نص ولا تعرض OCR إلا حين يحتاجه الملف فعلًا، فلا تدفع أبدًا مقابل OCR لم تكن بحاجة إليه.

  2. 2.

    شغّل OCR يدويًا إذا خرج النص مشوّشًا

    النسخ الممسوحة القديمة تحمل أحيانًا طبقة OCR رديئة من سنوات مضت، وهي تخدع أي كشف تلقائي. لذلك تُبقي صفحة النتيجة زر «شغّل OCR بدلًا من ذلك» — استخدمه حين يصلك النص مشوّهًا.

  3. 3.

    راجع الصفحات متعددة الأعمدة

    الأعمدة الجانبية والحواشي والأبحاث ذات العمودين تُقرأ بالترتيب الذي يخزّنه الملف، وهو لا يطابق دائمًا ترتيب القراءة. تصفّح تلك المواضع قبل الاعتماد عليها.

  4. 4.

    قسّم المستندات الطويلة جدًا

    حدود الصفحات موجودة لأن الوقت يزداد مع الطول. الكتب والملفات الكبيرة يفضَّل تحويلها فصلًا فصلًا — وستكون مراجعة النتيجة أسهل بكثير.

Key Capabilities

ما الذي تتولاه أداة تحويل PDF إلى Markdown هذه

مصمّمة للمستندات التي تنوي مواصلة العمل عليها، لا قراءتها فحسب.

OCR لملفات PDF الممسوحة

الصفحات بلا طبقة نص يجري التعرّف عليها من الصور: النسخ الممسوحة والصور والنماذج، بأكثر من 170 لغة، من بينها الصينية واليابانية والكورية.

البنية محفوظة

مستويات العناوين والقوائم المتداخلة والاقتباسات تعود بصيغة Markdown حقيقية، لا كعجينة فقرات مسطّحة.

جداول بخطوط عمودية

الجداول ذات الإطارات يُعاد بناؤها بأعمدة مصطفّة وتُعرض بشكل صحيح في أي محرر Markdown أو ويكي أو مستودع.

المعادلات والصور

الصور المضمّنة تنتقل مع المستند، ويستعيد OCR الترميز الرياضي من الصفحات التقنية الممسوحة.

العودة إلى Word

أرسل Markdown إلى محوّل Word بنقرة واحدة ونزّل ملف ‎.docx — المستند القابل للتحرير الذي لم يمنحك إياه ملف PDF.

يُحذف بعد التحويل

يُنقل ملفك عبر اتصال مشفّر ويُستخدم لهذا التحويل فقط ثم يُحذف. لا شيء يُحفظ ولا يُحلَّل.

Use Cases

من يستخدم تحويل PDF إلى Markdown

خمس مهام تؤديها هذه الأداة كل يوم — إحداها تشبه حالتك على الأرجح.

المطوّرون

استخرج من ملفات PDF مراجع الواجهات البرمجية وأوراق المواصفات وأدلة المورّدين وانقلها إلى موقع التوثيق أو ملف README أو الويكي — Markdown يدخل مباشرة إلى نظام إدارة الإصدارات.

الباحثون

حوّل الأبحاث إلى ملاحظات Markdown لـ Obsidian أو Notion أو Zotero. الأعداد القديمة الممسوحة تمرّ عبر OCR، والمعادلات تعود بصيغة LaTeX بدل رموز مكسورة.

الكتابة والتحرير

احصل على نص نظيف قابل للتحرير من تقارير العملاء والملخّصات والملفات الصحفية دون إعادة كتابة صفحة واحدة، ثم تابع في محرر Markdown الذي تستخدمه أصلًا.

الطلاب

حوّل شرائح المحاضرات والمذكّرات والملاحظات المصوّرة إلى Markdown يمكن البحث فيه وتلخيصه وإعادة ترتيبه قبل الامتحان. الصفحات المصوّرة يتكفّل بها OCR.

مسارات الذكاء الاصطناعي وRAG

Markdown هو ما تقرأه النماذج اللغوية على أفضل وجه. حوّل ملفات PDF المصدرية قبل تغذية قاعدة معرفة أو مجموعة ضبط دقيق أو موجّه: البنية محفوظة، وبلا ضوضاء PDF.

Simple Process

كيف تحوّل PDF إلى Markdown

ثلاث خطوات، ولا تحتاج حسابًا لتبدأ.

01

ارفع ملف PDF

اسحب الملف أو اختره من جهازك. يُتحقق من الحجم وعدد الصفحات قبل أي معالجة، فلا تنتظر أبدًا ملفًا سيُرفض على أي حال.

02

رقمي أم ممسوح — تُكتشف نيابةً عنك

المستندات التي فيها طبقة نص تُحوَّل فورًا. وإن تبيّن أن الملف نسخة ممسوحة، تُسأل قبل تشغيل OCR — ولا خصم صامت أبدًا.

03

انسخ Markdown أو نزّله

راجع النتيجة، ثم انسخها إلى الحافظة أو نزّل ملف ‎.md. وإذا خرجت نسخة ممسوحة مشوّهة، فزر واحد يعيد تمريرها عبر OCR.

FAQ

أسئلة شائعة عن تحويل PDF إلى Markdown

الحدود وOCR والجودة والخصوصية، بإجابات مباشرة.

1

هل أداة تحويل PDF إلى Markdown هذه مجانية؟

نعم. لكل زائر تحويلات مجانية يوميًا، وإنشاء حساب يرفع حدود الحجم وعدد الصفحات. أما OCR للملفات الممسوحة فيستهلك رصيدًا واحدًا لكل تحويل، لأن خلفه محرك تعرّف مدفوع.

2

هل تعمل مع ملفات PDF الممسوحة ضوئيًا؟

نعم، وهذا بالضبط ما يفصلها عن معظم الأدوات المجانية. تتحقق الأداة مما إذا كان ملفك يحتوي على طبقة نص حقيقية؛ فإن لم توجد عرضت OCR الذي يقرأ الحروف من صور الصفحات.

3

ما حدود الحجم وعدد الصفحات؟

بدون حساب يمكنك تحويل ملفات حتى 10 ميغابايت و30 صفحة. وبتسجيل الدخول يرتفع الحد إلى 30 ميغابايت و150 صفحة ويُفعَّل OCR للملفات الممسوحة، بينما يصل المشتركون إلى 50 ميغابايت و300 صفحة.

4

ما اللغات التي يتعرّف عليها OCR؟

أكثر من 170 لغة، منها الصينية واليابانية والكورية والعربية واللغات الأوروبية الرئيسية. والصفحات التي تخلط بين لغات تُعالَج في مرور واحد، فلا حاجة إلى اختيار اللغة مسبقًا.

5

هل تُحفظ الجداول؟

الجداول ذات الإطارات تتحول إلى جداول Markdown بشكل موثوق. أما الجداول بلا خطوط والخلايا المدمجة بكثرة فهي نقطة ضعف أي محلّل PDF، لذا راجع تلك المواضع قبل الاعتماد عليها.

6

ماذا يحدث لصور الملف؟

الصور المضمّنة تُستخرج ويُشار إليها داخل Markdown، فتنتقل مع المستند. وفي الملفات الكبيرة المزدحمة بالصور قد تُستبعد الصور للحفاظ على ملف قابل للاستخدام، وسنخبرك حين يحدث ذلك.

7

هل المعادلات الرياضية مدعومة؟

في المستندات الممسوحة يستعيد OCR المعادلات بترميز LaTeX. أما في ملفات PDF الرقمية فتُخزَّن بنية المعادلات كرموز موضوعة في مواقعها لا كترميز، لذا تصل المعادلات المعقّدة كحروف عادية — وتشغيل OCR على تلك الصفحات يعطي نتيجة أفضل غالبًا.

8

لماذا تبدو نتيجتي مبعثرة؟

التنسيقات متعددة الأعمدة والأعمدة الجانبية والحواشي تُقرأ بالترتيب الذي يخزّنه الملف، وهو لا يطابق دائمًا ترتيب قراءة الإنسان. المستندات بعمود واحد تعطي نتائج أنظف بكثير. وإن بدا النص نفسه مشوّهًا فالأرجح أن الملف يحمل طبقة OCR رديئة — استخدم «شغّل OCR بدلًا من ذلك» في صفحة النتيجة.

9

هل ملف PDF الخاص بي آمن؟

نعم. يُنقل ملفك عبر اتصال مشفّر، ويُستخدم فقط لإجراء التحويل الذي طلبته، ويُزال من التخزين فور انتهاء المعالجة. لا نقرأ مستنداتك، ولا نستخدمها أبدًا لتدريب النماذج، ولا نبيعها ولا ننشرها. وتوضّح سياسة الخصوصية بالتفصيل كيفية التعامل مع الملفات المرفوعة.

10

هل يستهلك تحويل ملف PDF رصيدًا؟

بعد تسجيل الدخول، كل تحويل يستهلك رصيدًا: رصيد واحد لكل 30 صفحة، مع تقريب أي صفحات متبقية إلى رصيد كامل — وتنطبق القاعدة نفسها على OCR للملفات الممسوحة. أما المشتركون فيحوّلون بلا حدود.

حوّل ذلك الملف إلى شيء يمكنك تحريره

ممسوح ضوئيًا أو رقمي — إلى Markdown أولًا، ثم إلى Word أو PDF أو HTML.

ابدأ فورًا · تحويلات مجانية يوميًا · الملفات الممسوحة مدعومة بـ OCR