Arquivo
Converter PDF em Word (.docx) editável
Reconstrói o texto de um PDF como um documento .docx editável — parágrafo, hierarquia de título, negrito e itálico quando detectáveis, e lista simples —, sem reproduzir o layout original: coluna, caixa de texto e posicionamento exato não são preservados.
Isto reconstrói o texto com formatação básica — não é uma cópia idêntica do PDF. Coluna, caixa de texto, posicionamento exato de elementos e imagem não são preservados. O resultado serve para editar o conteúdo em texto, não para obter o mesmo layout visual do arquivo original.
Clique para escolher um PDF
Até 50 MB, sem proteção por senha
Processamento local: seu arquivo não sai do seu computador.
O que esta ferramenta reconstrói, e o que ela não tenta
Um PDF é, por natureza, um formato de "página impressa digital" — cada elemento tem uma posição exata, pensada para impressão, não para edição. Um documento Word é o oposto: pensado para reescrever, reorganizar e formatar como texto corrido. Converter de um para o outro não é uma cópia — é uma reconstrução, apoiada no que dá para identificar com confiança no texto do PDF (parágrafo, título, negrito, itálico, lista) e deliberadamente sem tentar reproduzir posição exata, coluna ou caixa de texto, algo que um documento Word simplesmente não representa da mesma forma que um PDF.
De onde vem cada parágrafo
O texto do PDF é lido item por item, com a posição de cada trecho na página. Itens próximos verticalmente formam uma linha; linhas próximas o suficiente, sem um espaço maior de separação entre elas, formam um parágrafo — a mesma lógica usada por qualquer ferramenta deste portal que precisa reconstruir texto corrido a partir de um PDF. Quando uma linha termina com uma palavra cortada por hífen (comum em texto justificado para impressão), a palavra é reconstituída antes de entrar no parágrafo final.
Como o título é identificado
Não existe uma marcação explícita de "isto é título" dentro de um PDF comum — o que existe é uma fonte maior, usada visualmente para destacar uma seção. Esta ferramenta calcula o tamanho de fonte mais comum do documento (o "corpo do texto") e compara cada parágrafo a essa referência: um parágrafo com fonte bem maior vira título de nível 1, um pouco maior vira nível 2, e assim por diante. É uma estimativa por proporção — pode errar em um documento com uso de fonte fora do padrão comum, ou que não usa tamanho de fonte para destacar seção nenhuma.
Negrito e itálico: só quando o PDF de fato informa
Cada fonte embutida num PDF carrega (às vezes) uma informação própria sobre seu estilo — se é uma variante em negrito, em itálico, ou nenhum dos dois. Quando essa informação está disponível de forma clara, o texto sai com o mesmo estilo no documento gerado. Quando não está — uma fonte com nome genérico, sem indicação clara de estilo —, o texto sai sem negrito nem itálico, em vez de arriscar aplicar um valor que não foi de fato lido do arquivo. Essa é a diferença entre "detectado" e "inventado", e esta ferramenta só faz a primeira coisa.
Lista simples, sem preservar o estilo exato de numeração
Uma linha que começa com marcador de lista — símbolo de marcador (•, -, *) ou numeração (1., 2.) — é reconhecida como item de lista e convertida para uma lista com marcador no documento gerado. O estilo exato do marcador original (numeração romana, letra, símbolo específico) não é preservado — todo item de lista detectado sai com o mesmo formato de marcador no resultado, uma simplificação deliberada para manter a conversão confiável em vez de tentar recriar cada variação possível de estilo de lista.
Por que o aviso de honestidade vem antes de processar
A expectativa mais comum ao usar um conversor de PDF para Word é abrir o resultado e encontrar uma cópia visual do original — o que esta ferramenta não entrega, de propósito. Por isso o aviso sobre o que não é preservado aparece na tela antes mesmo de escolher o arquivo, não só depois do resultado pronto ou escondido numa pergunta frequente: quem usa decide com a expectativa certa desde o início, não depois de já ter gerado o documento.
O que esta ferramenta não faz
Ela não reproduz coluna, caixa de texto, tabela como grade visual, imagem nem posicionamento exato de nenhum elemento — só o texto, reconstruído como parágrafo, título, negrito, itálico e lista simples. Não reconhece texto dentro de uma imagem (para isso, a ferramenta de OCR deste portal). Não funciona com PDF protegido por senha, que precisa ter a proteção removida antes. E não garante que a hierarquia de título detectada corresponda exatamente à intenção de quem escreveu o documento original — é uma estimativa, a ser conferida com atenção antes de considerar o documento gerado como versão final para qualquer uso.
Perguntas frequentes
O documento gerado fica visualmente igual ao PDF original?
Não, e esta ferramenta não tenta isso. Ela reconstrói o CONTEÚDO em texto — parágrafo, título, negrito, itálico, lista simples — como um documento .docx editável. Coluna, caixa de texto, posicionamento exato de cada elemento na página e imagem não são preservados. O resultado serve para editar o texto, não para obter uma cópia idêntica do layout.
Como a ferramenta decide o que é título?
Pelo tamanho da fonte de cada parágrafo em relação ao tamanho mais comum do documento (o "corpo do texto") — um parágrafo com fonte bem maior que o corpo vira título de nível 1, um pouco maior vira nível 2, e assim por diante. É uma estimativa por proporção, não uma leitura de marcação: um PDF não declara "isto é título" em nenhum lugar, então a classificação pode errar em documentos com uso de fonte fora do padrão comum.
Por que negrito e itálico aparecem 'quando detectáveis', não sempre?
Porque a informação de negrito e itálico vem do descritor interno da fonte usada no PDF, e nem todo PDF disponibiliza essa informação de forma clara para leitura automática — alguns embutem uma fonte com nome genérico, sem indicar estilo. Quando não é possível determinar com confiança, o texto sai sem negrito nem itálico, em vez de aplicar um valor adivinhado.
Esta ferramenta consegue reconhecer texto dentro de uma imagem no PDF?
Não. Ela lê o texto que já existe como texto dentro do PDF (a camada extraída pelo pdf.js) — uma imagem dentro do PDF, mesmo que pareça texto visualmente, não é lida. Para isso existe uma ferramenta própria de reconhecimento óptico de caracteres (OCR) neste portal.
O texto extraído é enviado para algum servidor durante a conversão?
Não. Toda a leitura do PDF e a geração do .docx acontecem no navegador — o arquivo enviado não é transmitido a nenhum servidor deste portal.
Ferramentas relacionadas
- PDF para Excel
Detecta tabela num PDF pelo alinhamento de coluna e pela regularidade das linhas, mostra a prévia antes de gerar — com limite de coluna ajustável e opção de descartar tabela identificada por engano — e gera um .xlsx com uma aba por tabela ou por página, à escolha.
- OCR de imagem e PDF escaneado
Reconhece o texto de uma imagem ou de um PDF escaneado, página por página, em português ou inglês, com progresso e opção de cancelar — o resultado sai como texto simples e também na mesma estrutura usada para gerar .docx ou .xlsx diretamente, sem precisar de um PDF com texto real.
- Converter imagens em PDF
Controla a ordem das páginas, o tamanho do papel e a margem — pensado para páginas fotografadas com celular, não para PDFs prontos.
- Juntar arquivos PDF
Copia as páginas dos arquivos originais sem transformá-las em imagem, então texto e vetores continuam exatamente como estavam.