تبقى الملفات على الجهاز

تُعالَج الملفات في المتصفح ولا تُرفع إلى خوادمنا. قد ينزّل الموقع محركات المعالجة ويرسل أحداث الاستخدام أو الملاحظات دون محتوى الملفات.

كيف نتعامل مع البيانات →

PDF إلى HTML

تحويل PDF تقرير قابل للبحث إلى HTML: نسخة نصية مستقلة لمراجعة خفيفة في أي متصفح. لا يُحافظ على الطباعة والمخططات والجداول.

مثال اصطناعي — يُرجى مراجعة إعدادات العملية قبل التشغيل.

تبقى المستندات على هذا الجهاز. لا تتضمن عمليات تنزيل الأدوات وإحصاءات الاستخدام محتوى الملفات.

الحدود على الجهاز: الحد الأقصى للملف الواحد: 10 MB

تُعالج الملفات داخل المتصفح. لا تُرفع إلى هذا الموقع.

دليل عملي

مراجعة صياغة التقرير في ملف HTML محلي.

  1. اختيار تقرير يتضمن نصًا قابلًا للتحديد.
  2. تصدير HTML وفتح الملف المحفوظ محليًا.
  3. فحص كل قسم من أقسام الصفحات ومقارنة العبارات الحرجة بملف PDF.

تجربة هذا المثال

تصدير عرض من أربع صفحات إلى HTML. يُفتح محليًا ويُتأكد من بقاء بياني النطاق والسعر في أقسام صفحاتهما قبل تداول العرض النصي.

قبل

  • صفحات PDF ذات نص

بعد

  • أقسام صفحات HTML
المدخلات والنتيجة المتوقعة لهذه المهمة. مثال توضيحي.

قبل البدء: لا يحافظ التصدير على طباعة التقرير ولا مخططاته ولا جداوله؛ ولا يتعرف على النص الموجود في الصور فقط.

PDF إلى نص
ما الذي يتم الحصول عليه

تصدير النص المضمّن إلى مستند HTML مستقل بقسم واحد لكل صفحة. تُهرَّب رموز النص ولا يُنفَّذ بوصفه HTML. لا تُحفظ الخطوط الأصلية ولا الصور ولا الجداول ولا التخطيط؛ بلا OCR. الحدود: 10 MiB للمدخلات و200 صفحة و4 MiB للمخرجات.

الحدود والتفاصيل المهمة

10 MiB كحد أقصى للمدخلات، و200 صفحة، و4 MiB لمخرجات النص. تُبلغ المستندات الممسوحة ضوئيًا التي تفتقر إلى طبقة نصية عن خطأ بدلًا من استخراج ناجح زائف. قد لا يطابق ترتيب القراءة والأعمدة والخطوط التخطيط المرئي. هذا ليس OCR وليس تحويلًا من PDF إلى Word.

مثال

تصدير تقرير نصي وفتح ملف HTML الذي تم تنزيله محليًا. تتبع الأقسام ترتيب صفحات PDF؛ وتُوسم الصفحات الفارغة أو الممسوحة ضوئيًا ولا تُعامل بصمت كنص تم التعرف عليه.