Arquivo
Converter tabela de PDF em planilha Excel (.xlsx)
Detecta tabela num PDF pelo alinhamento de coluna e pela regularidade das linhas, mostra a prévia antes de gerar — com limite de coluna ajustável e opção de descartar tabela identificada por engano — e gera um .xlsx com uma aba por tabela ou por página, à escolha.
Clique para escolher um PDF
Até 50 MB, sem proteção por senha
Processamento local: seu arquivo não sai do seu computador.
O problema de "ler" uma tabela dentro de um PDF
Um PDF não guarda tabela como tabela — guarda texto posicionado. O que faz uma grade de números parecer uma tabela para quem olha é só o alinhamento visual: cada coluna começa sempre na mesma posição horizontal, linha após linha. Esta ferramenta usa exatamente esse sinal — alinhamento que se repete — para reconhecer onde uma tabela provavelmente está, sem depender de nenhuma marcação explícita de tabela, porque o PDF simplesmente não tem uma.
Como a detecção funciona
Primeiro, a posição horizontal de início de cada linha de texto na página é observada; posições que se repetem em várias linhas viram candidatas a início de coluna. Em seguida, sequências de pelo menos duas linhas consecutivas cujo texto se distribui por pelo menos duas dessas posições recorrentes são tratadas como uma tabela. As duas condições juntas — alinhamento de coluna e regularidade ao longo de várias linhas — reduzem a chance de confundir texto comum (que raramente mantém esse padrão por mais de uma linha) com uma tabela de verdade.
Por que a prévia vem antes do arquivo final
Detecção automática por alinhamento é uma estimativa — funciona bem para tabela com grade regular, mas pode errar em casos ambíguos: um índice com título de um lado e número de página do outro tem exatamente o padrão de duas colunas alinhadas, sem ser uma tabela de dados de verdade. Por isso o resultado aparece primeiro como prévia, editável, antes de qualquer arquivo ser gerado — dá para conferir se cada tabela identificada faz sentido antes de baixar qualquer coisa.
Ajustando o limite de uma coluna
Cada tabela detectada mostra a lista de posições horizontais usadas para separar as colunas, como números editáveis. Quando uma coluna sai incorretamente dividida em duas, ou duas colunas saem juntas numa só, essa lista pode ser editada diretamente — a prévia reagrupa o texto de cada linha imediatamente, usando as novas posições, sem precisar processar o PDF de novo. É um ajuste manual sobre um resultado automático, não uma segunda tentativa de detecção.
Descartando uma tabela identificada por engano
Nem toda sequência de linhas alinhadas é de fato uma tabela de dados — como no exemplo do índice, ou de um bloco de texto com recuo regular que por coincidência se alinha em mais de uma posição. Qualquer tabela detectada pode ser descartada individualmente antes de gerar o arquivo final, sem afetar as demais — o arquivo gerado inclui só as tabelas mantidas.
Uma aba por tabela, ou uma por página
Duas formas de organizar o resultado final: uma aba do Excel para cada tabela mantida (útil quando cada tabela é um conjunto de dados independente, mesmo vindas da mesma página), ou uma aba por página, juntando todas as tabelas mantidas daquela página, separadas por uma linha em branco — útil quando várias tabelas pequenas da mesma página fazem parte do mesmo contexto e faz mais sentido olhar juntas.
Número, moeda e data saem como texto lido, não recalculados
Cada célula da planilha gerada recebe exatamente o texto lido daquela posição da tabela original — um valor como "R$ 1.234,56" ou "31/12/2026" sai como esse texto, sem ser convertido para um número ou uma data reconhecida pelo Excel automaticamente. Isso preserva fielmente o que estava escrito no PDF, mas pode exigir um passo extra dentro do Excel (usar "Texto para colunas" ou reformatar a célula) se o objetivo for somar ou calcular em cima desses valores depois.
Por que só o texto entra na prévia, sem estilo visual
A prévia mostrada mantém alinhamento por coluna, mas não reproduz cor de fundo, borda de célula ou negrito que a tabela original possa ter no PDF — o foco da detecção é achar onde o dado está e como ele se organiza em linha e coluna, não replicar a aparência visual da tabela. O arquivo .xlsx gerado segue a mesma lógica: dado organizado, sem formatação visual da tabela de origem.
O que esta ferramenta não faz
Ela não lê tabela dentro de uma imagem — só texto que já existe como texto no PDF; para tabela fotografada ou escaneada, a ferramenta de OCR deste portal reconhece o texto primeiro. Não recupera fórmula: um PDF não guarda fórmula de planilha, só o resultado já calculado, então cada célula do arquivo gerado sai com o valor, nunca com um cálculo. E não reconhece tabela sem alinhamento de coluna consistente — um PDF que representa dado tabular de forma visual, mas sem coluna de verdade alinhada por trás (espaçamento manual irregular, por exemplo), pode não ser detectado.
Perguntas frequentes
Como a ferramenta reconhece uma tabela dentro do PDF?
Procura sequências de pelo menos duas linhas consecutivas cujo texto se alinha em pelo menos duas posições horizontais que se repetem várias vezes na página — o mesmo padrão visual de uma tabela real (colunas alinhadas, linha após linha). Texto corrido comum, sem esse alinhamento repetido, não é interpretado como tabela.
Por que a prévia aparece antes de gerar o arquivo, e não só o resultado final?
Porque detecção automática de tabela por alinhamento é uma estimativa, sujeita a acertar uma tabela real e também a confundir texto em colunas (como um índice ou um layout de duas colunas) com uma tabela. A prévia deixa conferir isso antes de gastar tempo gerando e baixando o arquivo — e permite ajustar o limite de coluna ou descartar uma tabela identificada por engano antes de gerar.
Como ajusto o limite de uma coluna que ficou errado?
Cada tabela detectada mostra a lista de posições horizontais usadas como limite de coluna, editável como texto (números separados por vírgula, em pontos). Mudar esses valores reagrupa o texto de cada linha imediatamente na prévia, sem precisar reprocessar o PDF inteiro.
A ferramenta lê tabela dentro de uma imagem, ou recupera fórmula de planilha original?
Não a nenhuma das duas coisas. Ela só reconhece tabela a partir do texto que já existe como texto no PDF — uma tabela fotografada ou escaneada como imagem não é lida (para isso, a ferramenta de OCR deste portal). E como um PDF não guarda fórmula de planilha, só o resultado já calculado como texto, nenhuma fórmula é recuperada — a célula sai só com o valor.
Qual a diferença entre uma aba por tabela e uma aba por página?
Uma aba por tabela cria uma planilha separada para cada tabela detectada e mantida, útil quando cada tabela representa um conjunto de dados independente. Uma aba por página junta todas as tabelas mantidas de uma mesma página na mesma planilha, separadas por uma linha em branco — útil quando várias tabelas pequenas da mesma página fazem parte do mesmo contexto.
Ferramentas relacionadas
- PDF para Word
Reconstrói o texto de um PDF como um documento .docx editável — parágrafo, hierarquia de título, negrito e itálico quando detectáveis, e lista simples —, sem reproduzir o layout original: coluna, caixa de texto e posicionamento exato não são preservados.
- OCR de imagem e PDF escaneado
Reconhece o texto de uma imagem ou de um PDF escaneado, página por página, em português ou inglês, com progresso e opção de cancelar — o resultado sai como texto simples e também na mesma estrutura usada para gerar .docx ou .xlsx diretamente, sem precisar de um PDF com texto real.
- Converter imagens em PDF
Controla a ordem das páginas, o tamanho do papel e a margem — pensado para páginas fotografadas com celular, não para PDFs prontos.
- Juntar arquivos PDF
Copia as páginas dos arquivos originais sem transformá-las em imagem, então texto e vetores continuam exatamente como estavam.