DOCX para PDF

Converta um .docx do Word em um PDF imprimível: o mammoth o converte em HTML limpo e a caixa de impressão gera o PDF, com imagens e tabelas.

A conversão acontece inteiramente no seu dispositivo com mammoth e o motor de impressão do navegador. Seu documento nunca sai dele.

Solte um .docx aqui ou clique para escolher — somente formato Word 2007 ou mais novo

Como funciona

A conversão roda em duas etapas totalmente locais: a biblioteca de código aberto mammoth transforma seu .docx em HTML semântico na página, e o motor de impressão do próprio navegador converte esse HTML em PDF quando você escolhe Salvar como PDF na caixa de imprimir.

DOCX é XML compactado
Um arquivo .docx é um pacote OOXML — um ZIP de partes XML. O mammoth o descompacta na memória, percorre o documento principal e traduz o que encontra em HTML, embutindo as imagens como data URIs em base64. Sem Word, sem instalar Office e sem servidor no meio.
Semântica, não pixels
A filosofia do mammoth é deliberada: ele mapeia significado, não layout. 'Cabeçalho 1' vira h1, negrito continua negrito, lista numerada vira ol — enquanto posições absolutas, cabeçalhos e rodapés, caixas de texto e quebras exatas de página são descartados porque o HTML não tem equivalente fiel. A saída fica limpa e imprimível, ao custo de não ser idêntica ao Word.
A caixa de imprimir é o conversor
O HTML gerado é renderizado num quadro oculto estilizado para papel A4 com margens de 20 mm via uma regra CSS @page. Ao clicar no botão, o quadro é enviado ao window.print() do navegador — o mesmo motor por trás de Imprimir em qualquer página — e as quebras de página que ele decide são as que ficam no arquivo.

Perguntas frequentes

O PDF é uma cópia pixel-perfect do documento do Word?

Não — e essa é a troca honesta de um conversor que nunca envia seu arquivo. O Word guarda a lógica de layout fora do texto, e replicá-la com precisão exige o motor da Microsoft, que os serviços de servidor rodam nas máquinas deles. Aqui, o mammoth extrai o significado e o navegador pagina em A4. Texto, títulos, listas, tabelas e imagens passam bem; a paginação exata e os espaçamentos do Word vão diferir.

As imagens são incluídas?

Sim. O mammoth lê as figuras do pacote .docx e as insere como data URIs base64 no HTML, então o motor de impressão as desenha direto. Caixas de texto e posicionamento flutuante de imagens não são preservados — as imagens caem no fluxo do texto perto de onde estavam. Arquivos com muitos escaneados em alta resolução ficam proporcionalmente pesados.

O que acontece com tabelas, listas e formatação?

A formatação semântica sobrevive: cabeçalhos viram níveis de heading, negrito e itálico continuam, listas ordenadas e não ordenadas seguem listas, e tabelas simples são renderizadas como tabelas. O que é simplificado: células mescladas, bordas exóticas, larguras de coluna exatas — e o que depender de estilos do Word que o mammoth não consiga mapear para significado HTML.

O que não sobrevive à conversão?

Cabeçalhos e rodapés de página, notas de rodapé, comentários, controle de alterações, caixas de texto, colunas e layout multi-seção são descartados — não há representação fiel no HTML semântico desse pipeline. Índices automáticos, objetos incorporados e macros também não convertem. Para isso, o arquivo precisa do Word de verdade ou de um serviço baseado em LibreOffice.

Algo é enviado para um servidor?

Não. O .docx é descompactado e traduzido para HTML no seu navegador pelo mammoth, e o PDF é produzido pelo motor de impressão do próprio navegador. Não há envio, conta ou requisição de rede contendo seu documento.