id

PDF ke Word

Ubah PDF secara lokal menjadi dokumen Word (DOCX) yang bisa diedit: judul, daftar, tebal/miring, tabel, dan gambar disertakan. Tanpa unggah.

Memproses secara lokal di perangkat Anda ...

Berkas Anda

    Memproses secara lokal di perangkat Anda ...

    0%

    Apakah berkas saya diunggah?

    Tidak. Semuanya berjalan di peramban Anda - berkas Anda tidak pernah meninggalkan perangkat. Bagaimana ini dapat diverifikasi

    Tanpa unggahan100% lokal
    Isi tetap milikmutanpa akses pihak ketiga
    Hosted in GermanyGlobal Content Delivery
    Diaudit independenTLS A+ · HTTP header A+

    PDF adalah tata letak yang sudah jadi, bukan teks yang bisa disunting: paragraf sulit diseleksi, kalimat tidak bisa ditulis ulang dengan nyaman, dan tabel tidak bisa dihitung lagi. Alat ini membaca struktur sesungguhnya dari PDF kamu, yaitu judul, paragraf, daftar, tabel, catatan kaki, dan gambar, lalu menyusun darinya sebuah berkas DOCX sungguhan berformat Office Open XML, langsung di perangkatmu sendiri. Berkas itu siap dibuka di Word, di LibreOffice Writer, atau di program lain mana pun yang memahami berkas .docx. Tanpa tanda air, tanpa akun, tanpa batas harian, karena konversinya berlangsung di tab peramban, bukan di server.

    Pada tataran paragraf dan karakter yang bertahan jauh lebih banyak daripada sekadar tebal dan miring. Judul menjadi judul Word sungguhan pada tingkat 1 sampai 6, lengkap dengan tingkat kerangka, sehingga panel navigasi dan daftar isi otomatis langsung berfungsi. Daftar berbutir bersarang mempertahankan tingkatannya sebagai daftar bertingkat yang sesungguhnya. Garis bawah dan coretan dikenali dari garis yang benar-benar tergambar pada halaman, huruf atas dan bawah dari garis dasarnya yang bergeser, sedangkan sorotan teks berwarna dipetakan ke warna terdekat di antara 16 warna sorotan yang dikenal format Word. Tautan dari PDF menjadi hipertaut Word yang bisa diklik, dan catatan di kaki halaman masuk ke pengelola catatan sebagai catatan kaki Word sungguhan, bukan sebagai teks lepas di ujung halaman.

    Tabel dikenali lewat tiga jalur berbeda: dari garis bingkai yang benar-benar tergambar, dengan lebar kolom diambil dari geometri garis yang terukur dan sel gabungan sederhana tetap tergabung; dari jarak antarkolom yang jelas berulang bila tabel sama sekali tidak bergaris; dan dari rangkaian sedikitnya tiga baris berurutan berbentuk «bidang: nilai», seperti yang dihasilkan PDF formulir. Ukuran halaman, orientasi tegak atau mendatar, margin, dan jumlah kolom teks diambil dari geometri halaman yang sebenarnya, bukan dari asumsi A4; di setiap batas halaman asli terpasang pemisah halaman yang rapi; gambar disematkan pada tempatnya dalam alur baca dengan rasio yang terjaga, dan diagram yang digambar murni sebagai vektor pun dikenali sebagai ilustrasi. Kepala dan kaki halaman yang berulang menjadi kepala dan kaki halaman Word sungguhan dengan tab kiri, tengah, dan kanan; nomor halaman yang berjalan menjadi bidang Word yang hidup, bukan angka yang membeku; tanda air yang berulang pun ikut terbawa.

    Untuk huruf, alat ini menempuh jalur langsung: program fon yang tersemat di PDF sumber dipindahkan tanpa diubah ke berkas Word, terpisah untuk potongan biasa, tebal, miring, dan tebal miring. Dengan begitu sebuah paragraf tebal memperoleh kontur asli dari rancangan hurufnya, bukan penebalan yang dihitung belakangan oleh pengolah kata. Hanya bila PDF sama sekali tidak membawa fon, barulah huruf pengganti berlisensi terbuka dengan metrik yang sepadan masuk, dan huruf itu pun disematkan ke dalam berkas, sehingga dokumen tetap tampil benar di komputer orang lain yang tidak memasang huruf tersebut. Teks di luar abjad Latin mendapat pula penandaan aksara dan bahasa yang tepat, agar Word membentuk aksara Tionghoa, Jepang, Korea, Arab, atau Ibrani dengan benar, menata dari kanan ke kiri di tempat yang semestinya, dan pemeriksa ejaan memilih bahasa yang tepat.

    Banyak pekerjaan tersimpan di PDF yang keluar dari kelaziman. Halaman yang disimpan miring dianalisis dalam arah bacanya sendiri, supaya tabel di atasnya tidak datang terbalik dan judulnya tidak tiba-tiba berdiri tegak. PDF yang dicetak dari peramban, misalnya lewat «Cetak ke PDF» di Chrome atau Edge, menggambar butir daftar sebagai kotak vektor yang sangat kecil alih-alih sebagai karakter teks, dan merekatkan satu baris tabel utuh menjadi satu baris teks: keduanya dikenali dari geometrinya lalu diurai kembali menjadi daftar sungguhan dan sel-sel tersendiri. Nomor halaman baru menjadi kepala atau kaki halaman bila ia benar-benar terus bertambah dari halaman ke halaman; baris tunggal yang hanya tampak seperti nomor halaman tetap tinggal di dalam teks, dan penanda halaman yang berubah-ubah seperti «K-6» atau «K-86» dipertahankan, bukan dibuang sebagai pernik tepi halaman.

    Ada dua hal yang alat ini katakan terus terang alih-alih disembunyikan. Bila di PDF sumber ada teks di balik batang hitam yang tidak tembus pandang namun masih terbaca sebagai teks, yaitu kesalahan klasik menyensor dengan persegi panjang yang dilukis di atasnya, teks itu tidak ikut ke berkas Word dan kamu diberi tahu di halaman mana hal itu terjadi. Dan bila karakter di dalam PDF sama sekali tidak membawa nilai Unicode, keadaan yang juga membuat penyalinan dari peramban PDF mana pun gagal, porsinya dinyatakan dengan angka dan kamu diarahkan ke «PDF OCR» alih-alih ditinggali lubang yang senyap. Analisis dan penyusunan berkas berlangsung sepenuhnya di tab peramban: PDF kamu tidak meninggalkan perangkatmu, dan setelah pemuatan pertama alat ini juga bekerja tanpa sambungan.

    Data teknis

    Data teknis
    Format masukanPDF
    Konversi otomatisPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
    Format keluaranDOCX
    Pemrosesan massalTidak
    PemrosesanLokal di peramban (JavaScript)
    Unggah berkasTidak ada

    Dalam 3 langkah

    1. Jatuhkan PDF kamu: tidak ada yang diunggah.
    2. Struktur, tabel, huruf, dan gambar dikenali secara lokal lalu dipindahkan ke DOCX.
    3. Unduh DOCX dan lanjutkan menyuntingnya di Word atau LibreOffice.

    Batasan: Pengalihan berbasis struktur, bukan salinan PDF piksel demi piksel. Yang dipindahkan: judul dengan tingkat kerangka, paragraf, daftar bernomor dan berbutir bertingkat, tebal, miring, garis bawah, coretan, huruf atas dan bawah, sorotan teks (dibulatkan ke warna sorotan Word), hipertaut yang bisa diklik, catatan kaki sungguhan, gambar dan diagram vektor dalam alur baca, kepala dan kaki halaman sungguhan dengan bidang nomor halaman yang hidup, serta format halaman, orientasi, margin, dan jumlah kolom dari geometri yang sebenarnya. Tabel dikenali dari garis bingkai, dari jarak antarkolom yang berulang, atau dari baris berbentuk «bidang: nilai»; untuk saat ini hanya satu wilayah tabel yang bersambung dinilai per halaman, sehingga beberapa tabel berbingkai terpisah yang bertumpuk di satu halaman sengaja mengalir sebagai teks biasa daripada disusun keliru, dan tabel yang bersarang dalam atau banyak selnya digabung tetap lemah. Setiap sel berisi satu paragraf. Batas jujur lainnya: bagian berwarna di dalam potongan teks yang tersusun menyambung kehilangan warnanya sendiri, dan sorotan yang hanya menutupi sebagiannya akan mewarnai seluruh potongan; tautan tanpa alamat tujuan yang tersimpan di PDF dilewati; tautan di dalam teks catatan kaki tidak tetap bisa diklik; daftar berbutir yang bersarang di dalam daftar bernomor mengambil tanda bernomor pada tingkatnya (isi dan sarangnya benar, hanya tandanya yang tidak); bila kepala halaman berganti tiap bab, ia tetap sebagai teks biasa di dalam dokumen alih-alih menjadi kepala halaman tersendiri per bab. Halaman bertata letak sangat cermat dengan teks yang mengalir mengitari ilustrasi hanya didekati, dan pada halaman dengan ribuan unsur garis atau vektor pengenalan tabel dan grafik dilewati. PDF hasil pindaian atau yang hanya berisi gambar tidak punya lapisan teks: yang muncul adalah petunjuk ke «PDF OCR», bukan hasil kosong. Buka dulu PDF yang terlindungi kata sandi dengan «Buka Kunci PDF».

    Pertanyaan umum

    Apakah PDF diunggah?

    Tidak. PDF dibuka di tab peramban, dianalisis di sana, dan berkas Word pun disusun di sana; tidak ada server mana pun yang pernah melihat berkas itu. Setelah kunjungan pertama alat ini tetap bekerja bahkan dalam mode pesawat, dan itulah bukti paling sederhana bahwa tidak ada yang diunggah.

    Apakah berkas Word tampak persis seperti PDF?

    Tidak, dan itu memang disengaja. PDF adalah tata letak yang kaku, dokumen Word adalah teks yang mengalir: salinan titik demi titik tidak akan bisa disunting secara masuk akal di Word. Karena itu yang dipindahkan adalah maknanya: judul, paragraf, daftar, tabel, catatan kaki, gambar, kepala dan kaki halaman, serta format halaman dan margin. Halaman bertata letak sangat cermat dengan teks mengitari ilustrasi hanya didekati.

    Apakah judul tetap menjadi judul Word sungguhan?

    Ya. Baris yang tersusun lebih besar dan lebih tebal dikenali sebagai judul tingkat 1 sampai 6 dan diberi tingkat kerangka yang sesuai. Dengan begitu bukan hanya gaya yang berfungsi, melainkan juga panel navigasi dan daftar isi yang dibuat otomatis di Word, langsung dan tanpa kamu perlu merapikan format sendiri.

    Apakah huruf asli dari PDF dipertahankan?

    Ya, bila PDF membawanya. Berkas fon yang tersemat di PDF sumber dipindahkan tanpa diubah ke berkas Word, terpisah untuk potongan biasa, tebal, miring, dan tebal miring. Baru bila sebuah fon tidak ada di dalam PDF, huruf pengganti berlisensi terbuka dengan metrik yang sepadan masuk dan ikut disematkan, sehingga dokumen tetap tampil benar di komputer yang tidak memasang huruf tersebut.

    Apakah tabel dipertahankan?

    Tabel dengan garis bingkai yang terlihat menjadi tabel Word sungguhan, dengan lebar kolom dari geometri yang terukur dan sel gabungan sederhana tetap utuh. Tabel tanpa bingkai dengan jarak antarkolom yang jelas berulang serta baris formulir berbentuk «bidang: nilai» juga dikenali. Untuk saat ini hanya satu wilayah tabel yang bersambung dinilai per halaman: bila beberapa tabel berbingkai terpisah bertumpuk, semuanya sengaja mengalir sebagai teks biasa daripada disusun keliru.

    Apakah ini bekerja pada halaman yang diputar atau mendatar?

    Ya. Halaman yang tersimpan dalam keadaan terputar di dalam PDF dianalisis dalam arah bacanya sendiri, bukan arah baca bagian dokumen lainnya. Tabel pada halaman semacam itu karenanya mempertahankan baris dan kolomnya ke arah yang benar, dan judul tidak keliru diperlakukan sebagai teks yang tersusun tegak.

    Apakah daftar berbutir dari PDF yang dicetak lewat peramban dikenali?

    Ya. Saat mencetak ke PDF, Chrome dan Edge menggambar titik daftar bukan sebagai karakter teks melainkan sebagai kotak vektor yang sangat kecil, sehingga penanda daftar tidak terlihat oleh pembaca teks murni. Alat ini mengenalinya dari ukurannya dan dari kenyataan bahwa semuanya sejajar dalam satu kolom, lalu memulihkan daftar beserta seluruh tingkatannya. Dari sumber yang sama, baris tabel yang saling merekat pun diurai kembali menjadi sel tersendiri.

    Apakah gambar, tautan, dan catatan kaki ikut dipindahkan?

    Ya, ketiganya. Gambar yang tersemat disisipkan pada tempatnya dalam alur baca, dengan lebar yang dibatasi dan rasio yang terjaga; diagram yang digambar murni sebagai vektor pun dikenali sebagai ilustrasi. Tautan dengan tujuan yang tersimpan menjadi hipertaut Word yang bisa diklik, dan catatan di kaki halaman menjadi catatan kaki Word sungguhan. Tautan tanpa alamat tujuan dilewati, dan tautan di dalam teks catatan kaki tidak tetap bisa diklik.

    Apa yang terjadi pada teks yang tertutup batang hitam di PDF sumber?

    Teks itu tidak ikut ke berkas Word. Bila penyensoran dilakukan dengan melukis persegi panjang hitam di atas teks alih-alih benar-benar menghapusnya, teks tersebut tetap terbaca sepenuhnya di dalam PDF, sebuah kesalahan yang sering terjadi dan berdampak besar. Alat ini mengenali teks yang seluruhnya berada di balik bidang gelap yang tidak tembus pandang, meninggalkannya di luar, dan memberi tahu kamu di halaman mana itu terjadi.

    Apa yang terjadi pada PDF hasil pindaian?

    Hasil pindaian terdiri atas gambar dan tidak punya lapisan teks. Alat ini mengatakannya dengan jujur dan mengarahkan ke «PDF OCR» alih-alih membuat berkas Word yang kosong. Bila sebuah berkas memang membawa teks tetapi karakternya tidak menyimpan nilai Unicode, porsi yang terpengaruh dinyatakan dengan angka: saat itu penyalinan dari peramban PDF pun gagal, dan OCR adalah jalan kembali ke teks.

    Alat terkait

    Konversi DOCX ke PDF · PDF ke EPUB · PDF ke Markdown · PDF OCR (dapat dicari) · PDF ke teks