DOCX ke PDF

Konversi .docx Word ke PDF siap cetak: mammoth menyusun HTML bersih lalu dialog cetak browser menyimpannya, lengkap dengan gambar dan tabel.

Konversi berjalan sepenuhnya di perangkat Anda dengan mammoth dan mesin cetak browser. Dokumen Anda tidak pernah keluar darinya.

Lepaskan .docx di sini atau klik untuk memilih — hanya format Word 2007 ke atas

Cara kerja

Konversi berjalan dalam dua tahap yang sepenuhnya lokal: pustaka sumber terbuka mammoth mengubah .docx Anda menjadi HTML semantik di dalam halaman, lalu mesin cetak browser Anda mengubah HTML itu menjadi PDF ketika Anda memilih Simpan sebagai PDF di dialog cetak yang terbuka.

DOCX adalah XML terkompres
Berkas .docx adalah paket OOXML — arsip ZIP berisi bagian XML. mammoth membukanya di memori, menelusuri dokumen utama, dan menerjemahkan temuannya ke HTML, sambil menyematkan gambar sebagai data URI base64. Tanpa Word, tanpa instalasi Office, tanpa server.
Semantik, bukan piksel
Filosofi mammoth memang disengaja: ia memetakan makna, bukan tata letak. 'Heading 1' menjadi h1, tebal tetap tebal, daftar bernomor menjadi ol — sedangkan posisi absolut, kepala dan kaki halaman, kotak teks, serta pemutusan halaman persis dibuang karena HTML tak punya padanan setia. Hasilnya bersih dan siap cetak, dengan konsekuensi penampilannya tidak persis Word.
Dialog Cetak Itulah Konverternya
HTML hasil konversi dirender ke bingkai tersembunyi yang ditata untuk kertas A4 bermargin 20 mm lewat aturan CSS @page. Saat tombol ditekan, bingkai itu dikirim ke window.print() browser — mesin yang sama di balik Cetak pada halaman web mana pun — dan keputusan patahan halamannya adalah yang Anda dapat di berkas.

Pertanyaan yang sering diajukan

Apakah PDF-nya persis sama dengan dokumen Word?

Tidak — dan itu konsekuensi jujur dari konverter yang tidak pernah mengunggah berkas Anda. Word menyimpan logika tata letak di luar teks, dan mereplikasinya secara persis butuh mesin perender Microsoft yang dijalankan layanan berbasis server di mesin mereka. Di sini mammoth mengekstrak makna dokumen lalu browser Anda menatanya di kertas A4. Teks isi, judul, daftar, tabel, dan gambar lolos dengan baik; paginasi persis dan spasi khas Word akan berbeda.

Apakah gambarnya ikut terbawa?

Ya. mammoth membaca gambar dalam paket .docx dan menanamnya sebagai data URI base64 di HTML, sehingga mesin cetak menggambarnya langsung. Kotak teks dan penempatan gambar mengambang tidak dipertahankan — gambar jatuh ke alur teks di sekitar posisi aslinya. Berkas dengan banyak pindai resolusi tinggi pun menjadi jauh lebih berat.

Bagaimana nasib tabel, daftar, dan format?

Format semantik bertahan: heading menjadi tingkat heading, tebal dan miring tetap ada, daftar bernomor dan berbutir tetap daftar, dan tabel sederhana dirender sebagai tabel. Yang disederhanakan: sel gabungan, garis eksotis, lebar kolom persis — serta apa pun yang bergantung pada gaya Word yang tidak dapat dipetakan mammoth ke makna HTML.

Apa yang tidak lolos konversi?

Kepala dan kaki halaman, catatan kaki, komentar, telusur perubahan, kotak teks, kolom, dan tata letak multi-bagian dilepaskan — tidak ada padanan setianya di HTML semantik yang dihasilkan alur ini. Bidang daftar isi, objek tertanam, dan makro juga tidak ikut. Untuk itu, berkas memerlukan Word asli atau layanan berbasis LibreOffice.

Apakah ada yang diunggah ke server?

Tidak. .docx dibuka dan diterjemahkan menjadi HTML di browser Anda oleh mammoth, dan PDF-nya dihasilkan mesin cetak browser Anda sendiri. Tidak ada tahap unggah, akun, atau permintaan jaringan yang memuat dokumen Anda.