Saltar al contenido

OCR de PDF — Extraer texto de un PDF escaneado, gratis

OCR de PDF gratis: extrae el texto de PDF escaneados o de solo imagen, hasta 20 páginas por vez, en el navegador. El motor OCR se carga de una CDN la 1.ª vez.

Conversión en tu navegador · Sin registro

PDF de hasta 30 MB. El OCR procesa hasta 20 páginas por pasada.

También admite imágenes (PNG, JPG, WebP, AVIF): suelta una aquí.

También puedes pegar una captura de pantalla con Ctrl+V (⌘V en Mac).

La primera vez, tu navegador descarga el motor OCR y los datos del idioma elegido (varios megabytes) desde una CDN pública y los guarda en caché. Tu imagen nunca se sube.

Cómo usarla

  1. Elige un PDF escaneado (hasta 30 MB).
  2. Selecciona el idioma del texto y las páginas que quieres leer, por ejemplo 1-3, 5 (hasta 20 páginas por pasada).
  3. Haz clic en Extraer texto y luego edita, copia o descarga el resultado como archivo .txt.

Ejemplo

Un contrato escaneado de 3 páginas, páginas 1-3 → "--- Página 1 ---\nCONTRATO\nEl presente contrato se celebra…\n\n--- Página 2 ---\n…" como texto editable, guardado como contrato.txt.

Detalles y limitaciones

Las páginas se renderizan a unos 200 DPI y se reconocen una tras otra con tesseract.js en tu navegador; el PDF no se sube. El motor OCR y los datos de idioma se descargan desde una CDN pública (jsDelivr) la primera vez y se guardan en caché.

Si el PDF ya tiene texto seleccionable, cópialo directamente; el OCR es para páginas escaneadas o de solo imagen. No se admiten PDF protegidos con contraseña, y el resultado es texto plano sin maquetación.

FAQ

¿Cómo extraigo gratis el texto de un PDF escaneado?

Elige el PDF, el idioma y las páginas (hasta 20 por pasada) y haz clic en Extraer texto. Es gratis, no necesita cuenta y funciona en tu navegador. Para documentos más largos, vuelve a ejecutarlo con el siguiente rango de páginas.

¿Puede leer PDF en japonés o chino con texto vertical?

Sí. Elige japonés (vertical), chino simplificado (vertical) o chino tradicional (vertical). Para texto horizontal, usa la opción normal de japonés o chino.

¿Por qué el resultado sale vacío o lleno de errores?

El OCR necesita texto impreso y nítido. Los escaneos de baja resolución, la letra manuscrita, las fuentes poco comunes o un idioma mal elegido reducen la precisión. Comprueba que el idioma coincide con el documento y prueba con un escaneo más limpio.

Referencias de formatos

Página de la herramienta actualizada: