انتقل إلى المحتوى

تحويل PDF إلى نص — استخراج النص إلى TXT، بدون رفع

استخرج طبقة النص من ملف PDF كنص عادي في متصفحك. تُعاد بناء الأسطر والفقرات من مواضع النص؛ انسخه أو نزّل ملف .txt. بدون رفع.

تحويل في المتصفح · دون تسجيل

ملف PDF واحد · حتى 30 MB و200 صفحة · المعالجة على جهازك

طريقة الاستخدام

  1. اختر ملف PDF يحتوي على نص قابل للتحديد.
  2. أدخل الصفحات المراد قراءتها، مثلًا 1-3, 5، واختر ما إذا كنت تريد تعليم فواصل الصفحات.
  3. اختر «استخراج النص»، ثم انسخ النتيجة أو نزّلها كملف .txt بترميز UTF-8.

مثال

تقرير من صفحتين ← «--- صفحة 1 ---

التقرير الفصلي

الفقرة الأولى…» مع أسطر فارغة بين الفقرات.

التفاصيل والقيود

يأتي النص من طبقة النص الخاصة بملف PDF عبر pdf.js. تصبح العناصر الواقعة على خط الأساس نفسه سطرًا واحدًا، وتتحول الفجوات بين الكلمات إلى مسافات، ويبدأ تباعد الأسطر الأوسع فقرة جديدة. قد تختلط الأعمدة في الصفحات متعددة الأعمدة، وتُحفظ الفجوات الواسعة في الجداول كثلاث مسافات.

النصوص الصينية واليابانية والكورية مدعومة. لا تحتوي الصفحات الممسوحة ضوئيًا على طبقة نص، فتخرج فارغة؛ وتسردها الأداة مع رابط إلى OCR لملفات PDF. يُقرأ ملف PDF على جهازك.

FAQ

لماذا النص المستخرج فارغ؟

على الأرجح أن ملف PDF مسح ضوئي أو مجموعة صور، فهو يحتوي على صور للنص لا على أحرف. استخدم OCR لملفات PDF للتعرّف على النص بدلًا من ذلك.

لماذا تلتصق بعض الكلمات أو تنقسم بشكل غريب؟

تخزّن ملفات PDF أجزاءً من النص بمواضع محددة، لا جملًا. تُستنتج المسافات وفواصل الأسطر من تلك المواضع، لذا قد تؤدي الخطوط غير المعتادة أو تباعد الأحرف أو الأعمدة إلى نتائج غير مثالية.

هل يمكنني استخراج النص من ملف PDF محمي بكلمة مرور؟

ليس مباشرةً. أزل كلمة المرور أولًا بأداة فك قفل PDF إن كنت تعرفها، ثم استخرج النص من النسخة غير المقفلة.

مراجع التنسيقات

تاريخ تحديث صفحة الأداة: