Converter PDF para texto — Extrair texto em TXT, sem upload
Extraia a camada de texto de um PDF como texto simples no navegador. Linhas e parágrafos são reconstruídos pela posição; copie ou baixe um .txt. Sem upload.
Conversão no navegador · Sem registo
Um PDF · até 30 MB e 200 páginas · processamento no dispositivo
Como usar
- Escolha um PDF com texto selecionável.
- Digite as páginas a ler, por exemplo 1-3, 5, e escolha se quer marcar as quebras de página.
- Selecione Extrair texto e copie o resultado ou baixe-o como arquivo .txt em UTF-8.
Exemplo
Um relatório de 2 páginas → "--- Página 1 --- Relatório trimestral O primeiro parágrafo…" com linhas em branco entre os parágrafos.
Detalhes e limitações
O texto vem da própria camada de texto do PDF via pdf.js. Itens na mesma linha de base formam uma linha, espaços entre palavras viram espaços e um espaçamento maior entre linhas inicia um novo parágrafo. Páginas com várias colunas podem misturar as colunas, e espaços largos em tabelas são mantidos como três espaços.
Texto em chinês, japonês e coreano é suportado. Páginas digitalizadas não têm camada de texto, então saem vazias; a ferramenta as lista e leva ao OCR de PDF. O PDF é lido no seu dispositivo.
FAQ
Por que o texto extraído está vazio?
O PDF provavelmente é uma digitalização ou um conjunto de imagens, então contém imagens de texto em vez de caracteres. Use o OCR de PDF para reconhecer o texto.
Por que algumas palavras saem grudadas ou quebradas de um jeito estranho?
PDFs guardam pedaços de texto posicionados, não frases. Espaços e quebras de linha são deduzidos dessas posições, então fontes incomuns, kerning ou colunas podem gerar resultados imperfeitos.
Posso extrair texto de um PDF protegido por senha?
Não diretamente. Se você souber a senha, remova-a primeiro com Desbloquear PDF e depois extraia o texto da cópia desbloqueada.
Ferramentas relacionadas
Referências de formatos
Página da ferramenta atualizada: