Apa yang bertahan ketika PDF menjadi berkas Word

Anda mengubah sebuah PDF ke Word dan tabelnya keluar miring. Anda mengira konverternya jelek, mencoba yang lain, dan hasilnya kurang lebih sama. Ada masalah yang tidak hilang dengan berganti alat.

Ashton
Format

Memahami sebabnya memberi tahu Anda alat mana yang dipilih dan sejauh apa boleh berharap.

PDF itu cetakan, bukan dokumen

Yang ada di dalam sebuah PDF adalah daftar panjang perintah bertuliskan cetak karakter ini pada 72, 680. Tidak ada satu pun tempat di berkas itu yang mencatat di mana sebuah paragraf berakhir, atau dua baris mana yang dulunya satu baris dalam sebuah tabel.

Informasi itu dibuang begitu dokumen diekspor menjadi PDF, sebagaimana selembar kertas cetakan memang tidak membutuhkannya. Jadi mengembalikannya adalah penyusunan ulang, bukan konversi: bentuk aslinya disimpulkan dari letak karakternya.

Kalimat tunggal itu menjelaskan sisanya. Tabel keluar miring bukan karena konverter salah membaca tabelnya, melainkan karena tidak ada tabel untuk dibaca dan ia harus disimpulkan hanya dari posisi.

Yang bisa disimpulkan dan yang tidak pernah ada

Memisahkan keduanya memberi tahu Anda apa yang bisa membaik dan apa yang tidak.

  • Bisa disimpulkan. Pemisahan paragraf, dari jarak baris dan di mana baris berhenti. Tabel, dari apakah selnya berbaris lurus ke bawah. Judul, dari huruf yang lebih besar daripada tubuh teks. Algoritme yang lebih baik membuatnya lebih akurat.
  • Bisa ditarik langsung. Karakternya sendiri, dan gambar atau stempel apa pun yang tercetak di halaman. Semuanya objek nyata di dalam berkas dan tidak perlu ditebak.
  • Tidak pernah dicatat. Gaya Word apa yang dipakai aslinya, di mana tabel punya sel gabungan, berapa poin jarak antarparagraf. Tidak ada alat yang bisa menghasilkan ini.

Waspadai konverter yang menyalin tata letak persis

Sebagian alat mengiklankan keluaran yang sama persis dengan aslinya sampai ke piksel. Dibuka, memang benar begitu. Lalu Anda menyunting satu baris dan dokumen itu runtuh.

Mencapainya berarti menaruh teks dalam ratusan kotak teks yang dipaku pada koordinat tetap alih-alih ke dalam paragraf. Dokumen yang dibangun begitu tampak seperti aslinya tetapi tidak bisa digarap. Hapus satu karakter dan hanya kotak itu yang menyesuaikan, semua di sekelilingnya diam di tempat.

Yang Anda butuhkanYang dipilih
Membaca dan menyunting isinyaKonverter yang menyusun ulang paragraf
Hanya untuk dibacaJangan dikonversi, pakai pembaca PDF
Harus sama persis dengan cetakanJangan dikonversi, simpan PDF-nya
Menghitung dengan angkanyaKonversi ke lembar kerja

Konversi ada supaya Anda bisa menyunting. Keluaran yang tidak bisa disunting sudah kehilangan maksudnya. Kalau tujuannya tampak identik, sejak awal tidak ada alasan untuk mengonversi.

Alasan sebenarnya tabel keluar salah

Tabel dalam PDF sangat sering sama sekali tidak bergaris. Kalaupun ada, garis itu digambar di lapisan yang berbeda dari teks, tak terlihat oleh apa pun yang menarik kata keluar. Itulah sebabnya pendekatan yang dibangun di atas pencarian garis begitu sering gagal.

Jadi posisilah yang dibaca: sel yang tepi kirinya berdiri di tempat sama pada beberapa baris dianggap sebuah tabel. Metode ini paling lemah pada sel kosong. Sel kosong tidak meninggalkan jejak di berkas, jadi baris itu tampak kekurangan satu sel dan semua setelahnya bergeser satu.

Sel gabungan berperilaku sama. Mata Anda melihat dua sel menyatu; berkasnya memuat satu potong teks yang duduk sedikit lebih kiri daripada tetangganya.

Tidak ada alat yang bisa mengonversi PDF hasil pindaian

PDF yang dihasilkan mesin pindai kantor adalah satu foto per halaman. Mata Anda melihat huruf, berkasnya tidak memuat satu pun. Ini bukan keterbatasan alat, melainkan ketiadaan di sumbernya.

Pengenalan karakter optik bisa membuat teks dari gambar itu. Tetapi itu pengenalan, bukan penarikan, dan ia menyelipkan kesalahan seperti membaca angka nol sebagai huruf O. Dalam kontrak atau berkas yang diserahkan, kesalahan semacam itu mahal. Meminta berkas asli kepada penerbitnya biasanya lebih cepat.

Ringkasnya

Pertanyaan untuk sebuah konverter bukan seberapa mirip hasilnya, melainkan apakah Anda bisa menyunting apa yang keluar. Dan ketika hasilnya belum sempurna, bisa membedakan batas alat dari batas format akan menyelamatkan Anda dari berganti alat tanpa guna.

Pertanyaan umum

Mengapa konverter yang berbeda memberi hasil yang berbeda?
Karena aturan penyimpulannya berbeda. Seberapa lebar jarak baru dihitung sebagai pemisah paragraf, berapa baris sejajar baru dihitung sebagai tabel: setiap alat menarik garis itu di tempat yang sedikit berbeda. Karena itu satu alat lebih cocok untuk dokumen tertentu daripada yang lain.
Tabel saya terus keluar salah. Ada yang bisa dilakukan?
Makin banyak sel kosong sebuah tabel, makin buruk hasilnya, karena sel kosong tidak meninggalkan jejak di PDF. Kalau yang Anda butuhkan hanya tabelnya, mengonversi ke lembar kerja lebih baik daripada ke Word. Jalur lembar kerja memang sengaja menjatuhkan sel ke kolom, dan kesalahan letak lebih mudah diperbaiki dengan tangan.
Apakah gambar dan stempel ikut?
Ya. Keduanya objek nyata yang tercetak di halaman, jadi tidak perlu ditebak dan ditarik apa adanya. Letak jatuhnya mengikuti urutan baca dan bukan koordinat aslinya, sebab memakunya pada koordinat akan menghasilkan dokumen yang tidak bisa Anda sunting.
Jenis hurufnya berubah.
PDF memang menanam berkas huruf, tetapi tidak ada jaminan berkas itu membawa nama yang ditentukan dokumen aslinya, apalagi bahwa huruf yang sama terpasang di mesin yang membuka hasilnya. Jadi jenis huruf dibiarkan dan yang dipakai adalah bawaan.
Adakah konverter yang tidak mengunggah berkas saya?
Ada, alat-alat di situs ini bekerja begitu. Seluruh konversi selesai di dalam peramban, jadi tidak ada langkah unggah. Untuk memeriksanya, buka tab jaringan di alat pengembang lalu jalankan sebuah konversi.

Diperbarui 17 September 2026