PDF para texto (extrair texto de PDF)
Tire o texto de um PDF para citar, traduzir, analisar ou reaproveitar em outro lugar. O texto aparece página por página e pode ser copiado ou baixado em um arquivo .txt.
Funciona no seu navegador
Como usar
- Arraste um PDF (ou selecione).
- Escolha se quer separadores de página.
- Clique em “Extrair texto”.
- Copie o texto ou baixe o arquivo .txt.
Como funciona
O texto é lido da camada de texto do PDF com o pdf.js e remontado em linhas conforme a posição de cada fragmento na página. Layouts de várias colunas e tabelas podem sair em uma ordem de leitura diferente da disposição visual.
PDF digitalizados contêm apenas imagens de texto e não têm camada de texto; a ferramenta detecta isso e avisa que seria preciso OCR (reconhecimento óptico de caracteres).
Os arquivos são processados no seu navegador com as bibliotecas de código aberto pdf-lib e pdf.js: nada é enviado.
Exemplos
- Artigo científico
- Extraia o texto de um artigo para contar as palavras ou colar em um tradutor.
Usos comuns
- Copiar texto de PDF com layout travado
- Contar as palavras de documentos em PDF
- Levar o texto para outras ferramentas
Privacidade e segurança
Esta ferramenta funciona inteiramente no seu navegador. Seus arquivos e textos nunca são enviados para os nossos servidores — o processamento acontece no seu dispositivo e o resultado também é criado ali. Como cada ferramenta trata os arquivos
Perguntas frequentes
Por que o texto veio vazio?
O PDF provavelmente é uma digitalização (uma imagem). O suporte a OCR está nos planos.
A formatação é mantida?
Não — a saída é texto simples. Use o PDF para Word (em breve) se precisar de texto formatado.
Última atualização: