PDF para texto
Retire texto limpo e copiável de um PDF — como texto simples, Markdown ou por OCR para digitalizações.
Largue um PDF aqui
ou use o botão — um PDF de cada vez
PDF para texto extrai as palavras de um documento para que possa copiá-las, editá-las ou pesquisá-las. Lê a verdadeira camada de texto para um resultado exato, reconstrói a ordem de leitura linha a linha e pode gerar texto simples ou um Markdown leve. Se o PDF for uma digitalização sem camada de texto, ative o OCR e o motor no dispositivo lê as palavras a partir da imagem.
Como funciona
- Escolha o PDF.
- Escolha texto simples ou Markdown, e um intervalo de páginas se quiser.
- Para um PDF digitalizado, ative o OCR.
- Clique em Extrair e depois copie ou transfira o texto.
Exemplos de utilização
- Copiar uma citação de um relatório sem a voltar a escrever.
- Transformar um PDF em Markdown para reutilizar nas suas notas.
- Ler o texto de uma página digitalizada com OCR.
Perguntas frequentes
Porque é que falta texto ou está baralhado?
O texto provém da própria camada de texto do PDF e é reordenado por posição. As disposições complexas em várias colunas ainda o podem surpreender. Para digitalizações sem camada de texto, use o OCR.
O que faz o OCR?
O OCR lê as letras a partir da imagem de uma página usando um motor no dispositivo. É mais lento e não é perfeito, mas recupera texto de digitalizações e fotografias. Tudo permanece no seu navegador.
O Markdown é fiel?
O Markdown é o melhor possível: as linhas claramente maiores tornam-se títulos e os marcadores são mantidos. É um ponto de partida útil, não uma conversão perfeita ao pixel.
Os seus ficheiros permanecem no seu dispositivo
Esta ferramenta funciona inteiramente no seu navegador. Depois de a página carregar, nada do seu documento é enviado para um servidor — sem envio, sem conta, sem marca de água.
Ferramentas relacionadas
Ao selecionar ficheiros, confirma que os pode processar e aceita os Condições de utilização.