تبقى الملفات على الجهاز

تُعالَج الملفات في المتصفح ولا تُرفع إلى خوادمنا. قد ينزّل الموقع محركات المعالجة ويرسل أحداث الاستخدام أو الملاحظات دون محتوى الملفات.

كيف نتعامل مع البيانات →
كل أدوات PDF

PDF إلى HTML

تحويل نص PDF المضمّن إلى ملف HTML مستقل مفصول بحسب الصفحات لقراءة مريحة. لا تدخل الصور ولا التخطيط الأصلي في النتيجة.

مثال اصطناعي — يُرجى مراجعة إعدادات العملية قبل التشغيل.

تبقى المستندات على هذا الجهاز. لا تتضمن عمليات تنزيل الأدوات وإحصاءات الاستخدام محتوى الملفات.

الحدود على الجهاز: الحد الأقصى للملف الواحد: 10 MB

تُعالج الملفات داخل المتصفح. لا تُرفع إلى هذا الموقع.

دليل عملي

إبقاء عرض النص مرتبطًا بتسلسل صفحاته.

  1. اختيار ملف PDF يمكن تحديد نصه.
  2. تصدير HTML وفتح الملف المنزَّل محليًا.
  3. مقارنة الأقسام والصياغة الناتجة بملف PDF المصدر.

تجربة هذا المثال

تصدير عرض قابل للبحث من خمس صفحات إلى HTML. يُتحقق من أن ملخص الصفحة 1 وبيانات الاتصال في الصفحة 5 تظهر في الأقسام المتوقعة قبل مشاركة النسخة النصية.

قبل

  • صفحات PDF ذات نص

بعد

  • أقسام صفحات HTML
المدخلات والنتيجة المتوقعة لهذه المهمة. مثال توضيحي.

قبل البدء: هذا ليس عرضًا لملف PDF ولا تحويلًا يحفظ التنسيق؛ فالصور والتخطيط الأصلي مستبعدان.

المتابعة بملف PDF المصدر
ما الذي يتم الحصول عليه

تصدير النص المضمّن إلى مستند HTML مستقل بقسم واحد لكل صفحة. تُهرَّب رموز النص ولا يُنفَّذ بوصفه HTML. لا تُحفظ الخطوط الأصلية ولا الصور ولا الجداول ولا التخطيط؛ بلا OCR. الحدود: 10 MiB للمدخلات و200 صفحة و4 MiB للمخرجات.

الحدود والتفاصيل المهمة

10 MiB كحد أقصى للمدخلات، و200 صفحة، و4 MiB لمخرجات النص. تُبلغ المستندات الممسوحة ضوئيًا التي تفتقر إلى طبقة نصية عن خطأ بدلًا من استخراج ناجح زائف. قد لا يطابق ترتيب القراءة والأعمدة والخطوط التخطيط المرئي. هذا ليس OCR وليس تحويلًا من PDF إلى Word.

مثال

تصدير تقرير نصي وفتح ملف HTML الذي تم تنزيله محليًا. تتبع الأقسام ترتيب صفحات PDF؛ وتُوسم الصفحات الفارغة أو الممسوحة ضوئيًا ولا تُعامل بصمت كنص تم التعرف عليه.