Ir para a ferramenta
TOFY Uma empresa do grupo TOFY · ver todas as unidades
Docs Editorby TOFY

PDF para Excel

As tabelas do PDF viram uma planilha que abre no Excel, no LibreOffice e no Google Planilhas. Você confere o resultado antes de baixar — extrair tabela de PDF é inferência, e a conferência faz parte.

Antes de começar: um PDF não guarda tabelas — guarda pedaços de texto com uma posição cada. As colunas são deduzidas do alinhamento. Isso funciona bem em relatório, extrato e listagem, e mal em tabela com célula mesclada ou texto de célula em duas linhas.

Ou arraste o arquivo até aqui — um PDF de até 100 MB.

A leitura acontece dentro do seu navegador e o CSV é montado no seu dispositivo. Nada sai daí.

Como tirar uma tabela de dentro de um PDF

Envie o arquivo, veja a prévia, ajuste a tolerância se as colunas saírem juntas ou partidas demais, e baixe.

Por que o arquivo sai em CSV e não em .xlsx?

Porque CSV é o formato honesto para o que se consegue recuperar de um PDF: valores em linhas e colunas. Um .xlsx daria a impressão de trazer formatação, fórmula e tipo de dado, e nada disso existe dentro de um PDF. O CSV abre com dois cliques no Excel, no LibreOffice e no Google Planilhas.

Funciona em qualquer PDF?

Funciona bem quando a tabela tem colunas alinhadas — relatório de sistema, extrato, boletim, listagem. Funciona mal quando há célula mesclada, texto de célula em duas linhas ou alinhamento irregular. E não funciona em PDF digitalizado, que é imagem.

Como as colunas são descobertas?

Pelo mesmo sinal que o olho usa: numa tabela, as colunas começam sempre na mesma altura horizontal. A ferramenta junta a posição de início de cada pedaço de texto da página, e as posições que se repetem em muitas linhas viram as bordas das colunas.

O texto fora da tabela também é extraído?

Por padrão não: linhas em que tudo caiu numa coluna só são descartadas, e a ferramenta diz quantas foram. Há a opção de mantê-las na primeira coluna.

Meu PDF é digitalizado. E agora?

Um PDF digitalizado é uma imagem da folha: não há texto dentro dele, então não há o que extrair. Seria preciso reconhecimento óptico de caracteres, que não é oferecido aqui — e a ferramenta avisa em vez de devolver um arquivo vazio.

O PDF é enviado para algum servidor?

Não.

Também em Converter