OCR de PDF — Extraer texto de un PDF escaneado, gratis
OCR de PDF gratis: extrae el texto de PDF escaneados o de solo imagen, hasta 20 páginas por vez, en el navegador. El motor OCR se carga de una CDN la 1.ª vez.
Conversión en tu navegador · Sin registro
PDF de hasta 30 MB. El OCR procesa hasta 20 páginas por pasada.
También admite imágenes (PNG, JPG, WebP, AVIF): suelta una aquí.
También puedes pegar una captura de pantalla con Ctrl+V (⌘V en Mac).
La primera vez, tu navegador descarga el motor OCR y los datos del idioma elegido (varios megabytes) desde una CDN pública y los guarda en caché. Tu imagen nunca se sube.
Cómo usarla
- Elige un PDF escaneado (hasta 30 MB).
- Selecciona el idioma del texto y las páginas que quieres leer, por ejemplo 1-3, 5 (hasta 20 páginas por pasada).
- Haz clic en Extraer texto y luego edita, copia o descarga el resultado como archivo .txt.
Ejemplo
Un contrato escaneado de 3 páginas, páginas 1-3 → "--- Página 1 ---\nCONTRATO\nEl presente contrato se celebra…\n\n--- Página 2 ---\n…" como texto editable, guardado como contrato.txt.
Detalles y limitaciones
Las páginas se renderizan a unos 200 DPI y se reconocen una tras otra con tesseract.js en tu navegador; el PDF no se sube. El motor OCR y los datos de idioma se descargan desde una CDN pública (jsDelivr) la primera vez y se guardan en caché.
Si el PDF ya tiene texto seleccionable, cópialo directamente; el OCR es para páginas escaneadas o de solo imagen. No se admiten PDF protegidos con contraseña, y el resultado es texto plano sin maquetación.
FAQ
¿Cómo extraigo gratis el texto de un PDF escaneado?
Elige el PDF, el idioma y las páginas (hasta 20 por pasada) y haz clic en Extraer texto. Es gratis, no necesita cuenta y funciona en tu navegador. Para documentos más largos, vuelve a ejecutarlo con el siguiente rango de páginas.
¿Puede leer PDF en japonés o chino con texto vertical?
Sí. Elige japonés (vertical), chino simplificado (vertical) o chino tradicional (vertical). Para texto horizontal, usa la opción normal de japonés o chino.
¿Por qué el resultado sale vacío o lleno de errores?
El OCR necesita texto impreso y nítido. Los escaneos de baja resolución, la letra manuscrita, las fuentes poco comunes o un idioma mal elegido reducen la precisión. Comprueba que el idioma coincide con el documento y prueba con un escaneo más limpio.
Herramientas relacionadas
Referencias de formatos
Página de la herramienta actualizada: