PDF para Excel
As tabelas do PDF viram uma planilha que abre no Excel, no LibreOffice e no Google Planilhas. Você confere o resultado antes de baixar — extrair tabela de PDF é inferência, e a conferência faz parte.
Antes de começar: um PDF não guarda tabelas — guarda pedaços de texto com uma posição cada. As colunas são deduzidas do alinhamento. Isso funciona bem em relatório, extrato e listagem, e mal em tabela com célula mesclada ou texto de célula em duas linhas.
Ou arraste o arquivo até aqui — um PDF de até 100 MB.
Prévia da planilha
Planilha pronta
O arquivo sai em CSV com ponto e vírgula e com marca de codificação: abre direto no Excel em português, sem tela de importação.
A leitura acontece dentro do seu navegador e o CSV é montado no seu dispositivo. Nada sai daí.
Como tirar uma tabela de dentro de um PDF
Envie o arquivo, veja a prévia, ajuste a tolerância se as colunas saírem juntas ou partidas demais, e baixe.
Por que o arquivo sai em CSV e não em .xlsx?
Porque CSV é o formato honesto para o que se consegue recuperar de um PDF: valores em linhas e colunas. Um .xlsx daria a impressão de trazer formatação, fórmula e tipo de dado, e nada disso existe dentro de um PDF. O CSV abre com dois cliques no Excel, no LibreOffice e no Google Planilhas.
Funciona em qualquer PDF?
Funciona bem quando a tabela tem colunas alinhadas — relatório de sistema, extrato, boletim, listagem. Funciona mal quando há célula mesclada, texto de célula em duas linhas ou alinhamento irregular. E não funciona em PDF digitalizado, que é imagem.
Como as colunas são descobertas?
Pelo mesmo sinal que o olho usa: numa tabela, as colunas começam sempre na mesma altura horizontal. A ferramenta junta a posição de início de cada pedaço de texto da página, e as posições que se repetem em muitas linhas viram as bordas das colunas.
O texto fora da tabela também é extraído?
Por padrão não: linhas em que tudo caiu numa coluna só são descartadas, e a ferramenta diz quantas foram. Há a opção de mantê-las na primeira coluna.
Meu PDF é digitalizado. E agora?
Um PDF digitalizado é uma imagem da folha: não há texto dentro dele, então não há o que extrair. Seria preciso reconhecimento óptico de caracteres, que não é oferecido aqui — e a ferramenta avisa em vez de devolver um arquivo vazio.
O PDF é enviado para algum servidor?
Não.