PDF para Word
Extrai o texto de verdade de um PDF e o reorganiza em um novo documento Word como parágrafos — rápido, grátis, e processado inteiramente no seu navegador. Esta é uma conversão só de texto: imagens, tabelas e o layout original não são transferidos.
- Os arquivos nunca saem do seu dispositivo
- Grátis, sem cadastro
- Sem marcas d'água
- Funciona offline depois de carregado Beta
Como pdf para word
- 1
Adicione seu PDF
Solte o documento na página, ou escolha-o em um seletor de arquivos.
- 2
O texto é extraído automaticamente
O texto de cada página é lido e reorganizado em parágrafos — isso começa assim que o arquivo é adicionado, sem opções para configurar.
- 3
Baixe o .docx
Salve o documento Word convertido e abra-o no Word, Google Docs ou LibreOffice.
Como a extração de texto de PDF realmente funciona
Uma página de PDF não tem o conceito de "parágrafos" ou "títulos" da forma que um documento Word tem — internamente é um conjunto de trechos de texto posicionados, cada um dizendo, em efeito, "desenhe estes caracteres nesta coordenada x,y exata, nesta fonte". Não há um esquema, nenhuma estrutura de documento, nem sequer uma noção confiável de onde uma linha termina e a próxima começa; um leitor de PDF reconstrói a aparência visual de uma página pintando cada trecho de texto na posição declarada, e uma pessoa lendo o resultado percebe linhas e parágrafos só porque as posições por acaso se alinham dessa forma. Converter um PDF em um documento editável significa trabalhar de trás para frente a partir disso: agrupar trechos de texto que compartilham uma posição vertical parecida em linhas, depois notar onde o espaço vertical entre uma linha e a próxima é incomumente grande — um sinal de que um parágrafo acabou de terminar — e tratar isso como uma quebra de parágrafo. Isso é fundamentalmente uma reconstrução a partir de dados de posição, não uma leitura de alguma estrutura de documento oculta, e é exatamente por isso que a formatação original não pode ser recuperada: não havia informação de formatação estruturada no arquivo para recuperar, para começar, só onde a tinta foi colocada.
Por que o OCR é um problema diferente, e deliberadamente fora do escopo
É fácil supor que "ler um PDF" e "ler uma página digitalizada" são a mesma tarefa com a mesma ferramenta, mas eles resolvem problemas genuinamente diferentes. A extração de texto, o que esta ferramenta faz, lê texto que um PDF já armazena como texto — códigos de caracteres e posições, os mesmos dados que um leitor de PDF usa para deixar você selecionar e copiar uma frase. O OCR (reconhecimento óptico de caracteres) resolve um problema muito mais difícil: olhar para uma página que é só uma imagem, sem nenhum dado de texto em lugar nenhum do arquivo, e usar reconhecimento de imagem para adivinhar quais letras e palavras a imagem representa. Isso é uma tarefa fundamentalmente mais pesada — envolve processamento de imagem, modelos de reconhecimento de caracteres, e incerteza inerente sobre qual é sequer a resposta "certa" —, nada disso se aplica quando o texto já está ali como texto. Embutir um motor de OCR completo em uma ferramenta cujo apelo inteiro é rodar instantaneamente no seu navegador trocaria a velocidade e a simplicidade que tornam esta ferramenta útil pela minoria de PDFs que por acaso são digitalizações. Um PDF digitalizado, só imagem, é um caso real e comum, e esta ferramenta diz isso claramente nos seus resultados em vez de silenciosamente produzir um documento vazio — mas resolver isso de verdade significa recorrer a uma ferramenta de OCR dedicada, não forçar esta além do que ela honestamente faz.
Por que reorganizar o texto supera tentar simular o layout original
Um conversor mais ambicioso poderia tentar recriar o layout da página original — posicionando texto em caixas em coordenadas aproximadamente certas, adivinhando colunas, tentando reproduzir fontes. Na prática, isso produz um documento que parece superficialmente semelhante ao original, mas é quase impossível de realmente editar: texto sentado em caixas flutuantes desconectadas em vez de parágrafos fluindo, reorganizando mal no momento em que qualquer coisa é adicionada ou removida, e brigando com o usuário a cada edição. Reorganizar o texto extraído em parágrafos comuns, em vez disso — a abordagem que esta ferramenta adota — desiste deliberadamente da semelhança visual em troca de um documento que se comporta como um documento Word deve se comportar: digite no final de um parágrafo e ele quebra normalmente, apague uma frase e o resto da página se reorganiza da forma que os processadores de texto sempre funcionaram. Para o objetivo comum de colocar as palavras de um PDF em um documento editável — para citar, revisar, reaproveitar ou traduzir — essa troca é a certa, e é por isso que esta ferramenta não tenta ser uma ferramenta de preservação de layout vestida de editor de texto.
Perguntas frequentes
O documento Word vai ficar exatamente igual ao meu PDF?
Não, e não é essa a intenção. Esta ferramenta extrai o texto real de cada página e o reorganiza em parágrafos comuns em um novo documento Word. Imagens, tabelas, colunas, e as fontes e o layout originais não são transferidos. Se você precisa do texto em si — para citar, editar ou reaproveitar — é exatamente isso que esta ferramenta produz; se você precisa de uma réplica editável pixel a pixel do design da página original, nenhum conversor automático realmente entrega isso, e esta ferramenta é direta sobre essa troca em vez de fingir o contrário.
Meu PDF é enviado para algum lugar?
Não. Tanto a extração de texto quanto a criação do documento Word acontecem dentro do seu navegador — o PDF nunca sai do seu dispositivo. Não há servidor envolvido e nada para enviar, o que importa para contratos, currículos ou qualquer outra coisa que você prefira não mandar para lugar nenhum.
Por que recebi um documento vazio ou quase vazio?
Esta ferramenta lê texto que já está incorporado no PDF como texto — a mesma informação que um leitor de PDF deixa você selecionar e copiar. Um PDF que na verdade é só uma foto ou digitalização de uma página, sem nenhuma camada de texto por baixo, não tem nada para esta ferramenta ler, então o resultado volta vazio ou quase. Esta ferramenta não faz OCR (reconhecimento óptico de caracteres, que lê texto de dentro de uma imagem) — ela só extrai texto que já existe como texto. Se o seu documento é uma digitalização, você precisa de uma ferramenta de OCR, não desta.
Que qualidade de saída devo esperar?
Para um PDF comum baseado em texto — relatórios, cartas, artigos, documentos exportados — o texto extraído é preciso e as quebras de parágrafo geralmente caem nos lugares certos. Layouts de múltiplas colunas, tabelas e texto dentro de imagens são os casos em que uma abordagem de reorganização de texto mostra seus limites, já que a extração não tem nenhum conceito real de colunas ou células, só texto posicionado em uma página. Para qualquer coisa além de texto corrido simples, espere fazer alguma limpeza manual depois de abrir o .docx.
Posso converter vários PDFs de uma vez?
Sim — solte até 10 arquivos de uma vez e cada um é convertido em seu próprio .docx, baixável individualmente ou todos juntos como um ZIP.
Você também pode precisar
Word para PDF
Transforme um arquivo .docx em um PDF limpo e legível
PDF para JPG
Transforme cada página de um PDF em uma imagem
Comprimir PDF
Reduza PDFs digitalizados, com o compromisso explicado com clareza
Adicionar marca d'água a PDF
Carimbe RASCUNHO ou CONFIDENCIAL em cada página
JPG para PDF
Transforme fotos e digitalizações em um único PDF
Juntar PDF
Combine vários PDFs em um documento
Girar PDF
Endireite páginas que estão de lado
Dividir PDF
Extraia páginas ou divida um PDF em arquivos separados