O que é extraído
A ferramenta lê a camada de texto selecionável e separa páginas. Não analisa pixels nem envia o arquivo a OCR.
Uma digitalização sem camada OCR existente normalmente fica vazia.
Etapas
Escolha o PDF, informe all ou páginas e extraia. O texto real aparece antes das contagens.
Confira ordem e quebras, copie tudo ou baixe TXT UTF-8. Alterações apagam o resultado anterior.
Exemplos e ordem
Em cinco páginas, 1,3-4 cria três seções. Duas colunas podem se misturar porque o PDF armazena posições.
Tabelas perdem bordas e colunas; limites de página e quebras fornecidas permanecem.
Usos
Use em notas, busca, acessibilidade e migração para editor, comparando citações importantes.
TXT não mantém fontes, links, imagens, formulários ou layout. O original não muda.
Limites
PDFs criptografados, danificados ou com codificação incomum podem falhar. Teste um intervalo menor.
Não faz OCR de scans, fotos ou escrita manual. O arquivo é descartado ao fechar.
Perguntas frequentes
Saída vazia costuma ser imagem. A ordem depende da estrutura do PDF. TXT não mantém tabelas. Intervalos e rótulos de página são incluídos.