طريقة الاستخدام
اختر PDF وجرب أولًا تحديد الكلمات بالفأرة داخل قارئ PDF عادي.
استخرج النص القابل للتحديد من ملف PDF.
اختر PDF وجرب أولًا تحديد الكلمات بالفأرة داخل قارئ PDF عادي.
ابدأ الاستخراج. تقرأ الأداة محتوى النص المتاح في كل صفحة وتتبع ترتيب الاستخراج الذي يعيده PDF.js.
راجع النص الناتج من حيث فواصل الأسطر والأعمدة والرؤوس والحروف التي قد يختلف ترتيبها عن الصفحة البصرية.
تستخرج النص الموجود أصلًا ككائنات نص قابلة للتحديد داخل PDF وتحفظه كنص عادي.
أثناء استخدام تحويل PDF إلى نص تتم معالجة الملف داخل المتصفح في هذه النسخة من الموقع، ولا يُرسل محتوى المستند إلى محرك تحويل خارجي. قد تسجل إحصاءات الموقع نشاط استخدام مجهولًا، لكنها لا تحفظ محتوى الملف.
إنشاء نسخة TXT من PDF رقمي للبحث أو الملاحظات. نقل النص القابل للتحديد إلى سير عمل تحليل أو كتابة آخر.
اختبر تحديد النص داخل PDF قبل توقع نجاح الاستخراج. في المستندات متعددة الأعمدة قارن ترتيب النص المستخرج بالصفحة البصرية.
ملفات PDF المصورة فقط لا تحتوي على نص قابل للتحديد وتحتاج OCR، وهو مؤجل لمرحلة VPS/OCR. الخطوط ذات الترميزات غير المعتادة قد تنتج Unicode غير مثالي رغم أن الصفحة تبدو سليمة.