Pular para o conteúdo

OCR de PDF — Extrair Texto de PDF Escaneado, Grátis

OCR de PDF grátis: extraia texto de PDFs escaneados ou só com imagens, até 20 páginas por vez, no navegador. O mecanismo de OCR vem de uma CDN no 1º uso.

Conversão no navegador · Sem registo

PDF de até 30 MB. O OCR processa até 20 páginas por vez.

Imagens (PNG, JPG, WebP, AVIF) também funcionam: solte uma aqui.

Você também pode colar um print com Ctrl+V (⌘V no Mac).

No primeiro uso, o navegador baixa o mecanismo de OCR e os dados do idioma escolhido (alguns megabytes) de uma CDN pública e os guarda em cache. Sua imagem nunca é enviada.

Como usar

  1. Escolha um PDF escaneado (até 30 MB).
  2. Selecione o idioma do texto e as páginas a ler, por exemplo 1-3, 5 (até 20 páginas por vez).
  3. Clique em Extrair texto e depois edite, copie ou baixe o resultado como arquivo .txt.

Exemplo

Um contrato escaneado de 3 páginas, páginas 1-3 → "--- Página 1 ---\nCONTRATO\nPelo presente instrumento…\n\n--- Página 2 ---\n…" como texto editável, salvo como contrato.txt.

Detalhes e limitações

As páginas são renderizadas a cerca de 200 DPI e reconhecidas uma após a outra com o tesseract.js no seu navegador; o PDF não é enviado. O mecanismo de OCR e os dados de idioma são baixados de uma CDN pública (jsDelivr) na primeira vez e ficam em cache.

Se o PDF já tem texto selecionável, copie direto; o OCR é para páginas escaneadas ou só com imagens. PDFs protegidos por senha não são suportados, e o resultado é texto simples, sem layout.

FAQ

Como extrair texto de um PDF escaneado de graça?

Escolha o PDF, o idioma e as páginas (até 20 por vez) e clique em Extrair texto. É grátis, não precisa de conta e roda no seu navegador. Para documentos mais longos, rode de novo com o próximo intervalo de páginas.

Ele lê PDFs em japonês ou chinês com texto vertical?

Sim. Escolha japonês (vertical), chinês simplificado (vertical) ou chinês tradicional (vertical). Para texto horizontal, use a opção normal de japonês ou chinês.

Por que o resultado sai vazio ou cheio de erros?

O OCR precisa de texto impresso e nítido. Digitalizações em baixa resolução, letra cursiva, fontes incomuns ou o idioma errado reduzem a precisão. Confira se o idioma é o do documento e tente uma digitalização mais limpa.

Referências de formatos

Página da ferramenta atualizada: