Convertir PDF a texto — Extraer texto a TXT, sin subir
Extrae la capa de texto de un PDF como texto plano en tu navegador. Líneas y párrafos se reconstruyen por posición; cópialo o descarga un .txt. Sin subir.
Conversión en tu navegador · Sin registro
Un PDF · hasta 30 MB y 200 páginas · procesamiento en tu dispositivo
Cómo usarla
- Elige un PDF con texto seleccionable.
- Indica las páginas que leer, por ejemplo 1-3, 5, y elige si marcar los saltos de página.
- Selecciona Extraer texto y copia el resultado o descárgalo como archivo .txt en UTF-8.
Ejemplo
Un informe de 2 páginas → "--- Página 1 --- Informe trimestral El primer párrafo…" con líneas en blanco entre párrafos.
Detalles y limitaciones
El texto procede de la propia capa de texto del PDF mediante pdf.js. Los elementos de la misma línea base forman una línea, los huecos entre palabras se convierten en espacios y un interlineado mayor inicia un párrafo nuevo. En páginas de varias columnas, las columnas pueden mezclarse, y los huecos anchos de las tablas se conservan como tres espacios.
Se admite texto en chino, japonés y coreano. Las páginas escaneadas no tienen capa de texto, así que salen vacías; la herramienta las indica y enlaza a OCR de PDF. El PDF se lee en tu dispositivo.
FAQ
¿Por qué el texto extraído está vacío?
Lo más probable es que el PDF sea un escaneo o un conjunto de imágenes, así que contiene imágenes de texto en lugar de caracteres. Usa OCR de PDF para reconocer el texto.
¿Por qué algunas palabras salen juntas o cortadas de forma rara?
Los PDF guardan fragmentos de texto posicionados, no frases. Los espacios y saltos de línea se deducen de esas posiciones, así que fuentes poco habituales, el interletraje o las columnas pueden dar resultados imperfectos.
¿Puedo extraer texto de un PDF protegido con contraseña?
No directamente. Si conoces la contraseña, quítala primero con Desbloquear PDF y después extrae el texto de la copia desbloqueada.
Herramientas relacionadas
Referencias de formatos
Página de la herramienta actualizada: