OCR de PDF — Extrair Texto de PDF Escaneado, Grátis
OCR de PDF grátis: extraia texto de PDFs escaneados ou só com imagens, até 20 páginas por vez, no navegador. O mecanismo de OCR vem de uma CDN no 1º uso.
Conversão no navegador · Sem registo
PDF de até 30 MB. O OCR processa até 20 páginas por vez.
Imagens (PNG, JPG, WebP, AVIF) também funcionam: solte uma aqui.
Você também pode colar um print com Ctrl+V (⌘V no Mac).
No primeiro uso, o navegador baixa o mecanismo de OCR e os dados do idioma escolhido (alguns megabytes) de uma CDN pública e os guarda em cache. Sua imagem nunca é enviada.
Como usar
- Escolha um PDF escaneado (até 30 MB).
- Selecione o idioma do texto e as páginas a ler, por exemplo 1-3, 5 (até 20 páginas por vez).
- Clique em Extrair texto e depois edite, copie ou baixe o resultado como arquivo .txt.
Exemplo
Um contrato escaneado de 3 páginas, páginas 1-3 → "--- Página 1 ---\nCONTRATO\nPelo presente instrumento…\n\n--- Página 2 ---\n…" como texto editável, salvo como contrato.txt.
Detalhes e limitações
As páginas são renderizadas a cerca de 200 DPI e reconhecidas uma após a outra com o tesseract.js no seu navegador; o PDF não é enviado. O mecanismo de OCR e os dados de idioma são baixados de uma CDN pública (jsDelivr) na primeira vez e ficam em cache.
Se o PDF já tem texto selecionável, copie direto; o OCR é para páginas escaneadas ou só com imagens. PDFs protegidos por senha não são suportados, e o resultado é texto simples, sem layout.
FAQ
Como extrair texto de um PDF escaneado de graça?
Escolha o PDF, o idioma e as páginas (até 20 por vez) e clique em Extrair texto. É grátis, não precisa de conta e roda no seu navegador. Para documentos mais longos, rode de novo com o próximo intervalo de páginas.
Ele lê PDFs em japonês ou chinês com texto vertical?
Sim. Escolha japonês (vertical), chinês simplificado (vertical) ou chinês tradicional (vertical). Para texto horizontal, use a opção normal de japonês ou chinês.
Por que o resultado sai vazio ou cheio de erros?
O OCR precisa de texto impresso e nítido. Digitalizações em baixa resolução, letra cursiva, fontes incomuns ou o idioma errado reduzem a precisão. Confira se o idioma é o do documento e tente uma digitalização mais limpa.
Ferramentas relacionadas
Referências de formatos
Página da ferramenta atualizada: