PDF para CSV

Converta PDF para CSV online. Extraia tabelas de um PDF para um arquivo separado por vírgulas que abre no Excel, no Google Sheets, no Python ou em qualquer importação de banco.

PDF

ou arraste e solte o arquivo aqui

Carregue seu arquivo PDF

Conversão rápidaProcessamento seguroSem cadastro

Como funciona a conversão de PDF para CSV

O conversor procura tabelas no PDF, descobre onde estão as linhas e as colunas pela posição do texto e pelas linhas de grade, e grava as células em um arquivo CSV.

Quando um PDF tem várias tabelas, cada uma é gravada em seguida da outra com uma linha de título que indica a sua página, então você pode dividir o arquivo ou apagar as partes que não precisa.

Por que CSV em vez de Excel

CSV é texto puro, que é exatamente o que um script, uma importação de banco de dados ou uma ferramenta de dados quer. Nada precisa interpretar um formato de planilha para ler.

Ele também abre no Excel, no Google Sheets, no Numbers e no LibreOffice Calc. Escolha a nossa ferramenta PDF para Excel quando quiser a formatação, as células mescladas e uma planilha por tabela.

Casos de uso comuns

Levar um extrato bancário, uma lista de preços ou a tabela de um relatório para uma planilha sem redigitar linha por linha.

Carregar números de um PDF publicado em um script ou em um banco de dados, onde um CSV é o caminho mais curto do documento até a sua consulta.

O que esperar do resultado

O arquivo é UTF-8 com marca de ordem de byte, então acentos e texto não latino abrem corretamente no Excel com dois cliques. Valores que contêm uma vírgula ou uma aspa são citados como o padrão CSV exige.

CSV não tem espaço para células mescladas, cores ou várias planilhas, então um título mesclado é gravado na primeira de suas células. Um PDF sem camada de texto não contém tabela para a ferramenta achar e precisa de OCR primeiro.

Dicas para tabelas mais limpas

Tabelas com linhas de grade convertem com mais precisão, porque as linhas dizem à ferramenta exatamente onde cada coluna termina.

Abra o CSV e compare a primeira e a última linha com o PDF. Uma última linha faltando normalmente significa que a tabela continuava em uma página que o extrator tratou como separada.