Conversor de PDF para texto

Extraia o texto de um PDF para copiar ou salvar.

    Funciona no navegador. Seus arquivos nunca saem do seu dispositivo.

    Como converter PDF para texto

    1. Solte seus arquivos PDF aqui.
    2. Aguarde o texto ser extraído.
    3. Copie, ou baixe um arquivo .txt para cada PDF.

    O que a extração mantém e o que ela descarta

    • O texto simples de cada página, unido com uma linha em branco entre as páginas.
    • A ordem de leitura segue a ordem interna do próprio PDF, que nem sempre é igual ao layout visual.
    • Fontes, negrito, itálico, cores e imagens não são mantidos, só as próprias palavras.
    • Tabelas e páginas com várias colunas podem sair com células ou colunas intercaladas, em vez de uma ordem de leitura organizada.

    Um arquivo ou vários

    Coloque um único PDF na fila e o texto extraído também aparece em uma caixa na página com um botão Copiar, pronto para colar em outro lugar.

    Coloque mais de um PDF na fila e cada um é baixado como seu próprio arquivo .txt, ou todos juntos em um ZIP, já que mostrar vários documentos em uma só caixa não seria útil.

    Bons motivos para extrair texto de um PDF

    • Copiar um parágrafo ou cláusula de um contrato para um e-mail sem digitar tudo de novo.
    • Levar o texto de um relatório para um editor de texto para poder editar livremente.
    • Comparar duas versões de um documento colando o texto simples de cada uma em uma ferramenta de diff.
    • Levar o texto de um PDF para outra ferramenta deste site, como o Contador de palavras, que só lê texto simples.

    Perguntas frequentes sobre PDF para texto

    Por que o arquivo de texto está vazio?

    PDFs digitalizados são fotos de páginas sem camada de texto, então não há nada para extrair. Use o Imagem para texto em vez disso, que lê o texto de uma imagem.

    Isso mantém a formatação original?

    Não. Colunas, tabelas e fontes não são mantidas, só o texto simples, mais ou menos na ordem em que aparece na página.

    Posso converter vários PDFs de uma vez?

    Sim. Solte quantos quiser e baixe cada arquivo .txt, ou todos juntos em um ZIP.

    Meu documento é enviado?

    Não. O texto é extraído inteiramente dentro do seu navegador.

    Isso mantém as quebras de parágrafo e linha?

    O texto de cada página é separado por uma linha em branco. As quebras dentro de uma página seguem a ordem interna do próprio PDF, que geralmente corresponde às linhas visíveis, mas não é garantido.

    Um layout de várias colunas é extraído na ordem certa?

    Nem sempre. A extração segue a ordem em que o PDF guarda o texto, não as colunas visuais, então uma página de duas colunas pode sair com as colunas intercaladas.

    Isso funciona em PDFs protegidos por senha?

    Não diretamente. Remova a senha primeiro com o Desbloquear PDF e depois use o arquivo desbloqueado nesta ferramenta.

    E se só parte de uma página tiver texto de verdade?

    Essa parte ainda é extraída normalmente. Uma página que mistura um parágrafo de texto com uma imagem digitalizada retorna só o parágrafo, já que a parte da imagem não tem camada de texto para ler.

    Ferramentas relacionadas