تبقى الملفات على الجهاز
تُعالَج الملفات في المتصفح ولا تُرفع إلى خوادمنا. قد ينزّل الموقع محركات المعالجة ويرسل أحداث الاستخدام أو الملاحظات دون محتوى الملفات.
كيف نتعامل مع البيانات →PDF إلى Markdown
إنشاء نسخة نصية بصيغة Markdown من PDF قابل للبحث مع إبقاء تجميع صفحات المصدر. يُصدَّر النص الموجود حرفيًا؛ ولا يُعاد بناء التخطيط.
مثال اصطناعي — يُرجى مراجعة إعدادات العملية قبل التشغيل.
تبقى المستندات على هذا الجهاز. لا تتضمن عمليات تنزيل الأدوات وإحصاءات الاستخدام محتوى الملفات.
الحدود على الجهاز: الحد الأقصى للملف الواحد: 10 MB
تُعالج الملفات داخل المتصفح. لا تُرفع إلى هذا الموقع.
دليل عملي
إبقاء سياق الصفحة مع الصياغة المستخرجة.
- اختيار ملف PDF ذي طبقة نصية موجودة.
- التصدير إلى Markdown وفحص كل قسم من أقسام الصفحات.
- إعادة استخدام الصياغة التي سبق التحقق منها مقابل ملف PDF الأصلي فقط.
تجربة هذا المثال
تحويل موجز عميل قابل للبحث من ثلاث صفحات إلى Markdown. يُتحقق من أن التاريخ المطلوب وبندي الإجراء تحت عنوان صفحة المصدر نفسه كما في ملف PDF.
قبل
- PDF: Hello
بعد
- عنوان الصفحة + كتلة نص حرفية
ملف .md نموذجي
## Page 1
مرحبًا من ملف PDF، سارة أحمد!نص المصدر القابل للتحديد: مرحبًا من PDF.
قبل البدء: يصدّر هذا النص الموجود في كتل شيفرة حرفية؛ ولا يحوّل ملف PDF إلى تخطيط قابل للتحرير.
المتابعة بملف PDF المصدرما الذي يتم الحصول عليه
تصدير النص المضمّن في صورة كتل شيفرة Markdown حرفية مجمّعة حسب الصفحة. لا تتم إعادة بناء العناوين أو الجداول أو الصور أو التخطيط الأصلي. تُوسم الصفحات الخالية من النص؛ بلا OCR. الحدود: 10 MiB للمدخلات و200 صفحة و4 MiB للمخرجات.
الحدود والتفاصيل المهمة
10 MiB كحد أقصى للمدخلات، و200 صفحة، و4 MiB لمخرجات النص. تُبلغ المستندات الممسوحة ضوئيًا التي تفتقر إلى طبقة نصية عن خطأ بدلًا من استخراج ناجح زائف. قد لا يطابق ترتيب القراءة والأعمدة والخطوط التخطيط المرئي. هذا ليس OCR وليس تحويلًا من PDF إلى Word.
مثال
تصدير نص تقرير قابل للتحديد إلى ملف .md. تُنشأ عناوين الصفحات، ويبقى نص PDF حرفيًا داخل كتل الشيفرة فلا يتحول إلى HTML قابل للتنفيذ ولا إلى جداول مستنتجة. تجب مراجعة ترتيب القراءة قبل إعادة الاستخدام.