Apa yang bertahan ketika PDF menjadi berkas Word
Anda mengubah sebuah PDF ke Word dan tabelnya keluar miring. Anda mengira konverternya jelek, mencoba yang lain, dan hasilnya kurang lebih sama. Ada masalah yang tidak hilang dengan berganti alat.
Jatuhkan sebuah PDF dan teks di dalamnya disusun ulang menjadi paragraf dan tabel dalam berkas Word. Tidak ada yang ditempelkan sebagai gambar halaman, jadi yang Anda unduh adalah dokumen yang langsung bisa disunting.
Tanpa unggah
PDF yang akan diubah
PDF harus berisi teks sungguhan. PDF hasil pindai adalah gambar halaman, jadi tidak ada teks yang bisa diambil. Berkas hanya dibuka di browser ini dan tidak pernah diunggah.
Urutan baca, paragraf, dan tabel ikut dipindahkan. Posisi persisnya di halaman tidak. PDF tidak pernah mencatat mana paragraf dan mana tabel, jadi keduanya disusun ulang dari letak karakter-karakternya.
Gambar, stempel, dan tanda tangan yang tercetak di halaman juga diambil dan dimasukkan ke dokumen. Letaknya mengikuti urutan baca, bukan koordinat aslinya.
PDF hasil pindai berisi foto, bukan teks, jadi tidak ada yang bisa diubah. Masukkan saja berkasnya, alat ini akan langsung memberi tahu.
Halaman tidak ditempel utuh sebagai gambar. Berkas yang Anda unduh terbuka sebagai dokumen yang bisa diedit di Word atau Excel.
Berkasnya harus memuat teks sungguhan. Beberapa sekaligus juga boleh.
Tiap halaman dibaca untuk mengetahui letak karakternya, lalu dikelompokkan menjadi paragraf dan tabel. Kemajuannya ditunjukkan dengan nomor halaman.
Terbuka di Word siap disunting. PDF asli Anda tidak tersentuh.
PDF bukan format untuk menyimpan teks, melainkan untuk menggambar halaman. Yang ada di dalam berkas hanyalah daftar panjang perintah cetak karakter ini di sini, dan tidak ada tempat yang mencatat di mana sebuah paragraf berakhir atau blok angka mana yang dulunya sebuah tabel. Informasi itu dibuang begitu dokumen diekspor menjadi PDF.
Jadi ini penyusunan ulang, bukan konversi. Letak karakter, jarak antarbaris dan ukuran huruf dibaca kembali untuk menebak bentuk aslinya. Jarak yang lebih lebar dari biasanya, atau baris yang berhenti jauh sebelum tepi kanan, berarti sebuah paragraf berakhir di situ. Sel yang tepi kirinya berdiri di posisi sama pada beberapa baris berarti sebuah tabel.
Namanya tebakan, bisa saja meleset. Yang tidak akan dilakukannya adalah mengarang nilai yang tidak ditemukannya. Halaman tanpa teks dilaporkan kosong, dan dokumen yang sudah jadi dibaca ulang dan diperiksa sebelum sampai ke tangan Anda.
Urutan baca, paragraf, judul dan tabel ikut, begitu pula pergantian halaman. Gambar, stempel dan tanda tangan pada halaman juga ditarik keluar dan dimasukkan, hanya saja letaknya mengikuti urutan baca dan bukan koordinat aslinya. Yang tidak ikut adalah letak persis di halaman, jenis huruf dan warna teks.
Tata letaknya sengaja tidak ditiru. Mereproduksi posisi berarti menaburkan kotak teks pada koordinat tetap, dan dokumen yang dibangun begitu memang terbuka tetapi berantakan begitu Anda menyunting satu baris. Tujuan alat ini adalah dokumen yang bisa Anda garap.
| Butir | Ikut atau tidak |
|---|---|
| Urutan baca dan isi kalimat | Ikut |
| Pemisahan paragraf | Disusun ulang dari posisi |
| Judul | Huruf lebih besar dari tubuh teks dianggap judul |
| Tabel | Disusun ulang dari nilai yang berbaris |
| Pergantian halaman | Ikut |
| Jenis huruf, warna, tata letak persis | Tidak |
| Gambar, stempel, tanda tangan | Ya, ditaruh menurut urutan baca |
PDF yang dibuat dengan memotret kertas atau melewatkannya di mesin pindai adalah satu gambar untuk tiap halaman. Mata Anda melihat huruf, tetapi berkasnya tidak memuat satu pun. Tidak ada yang bisa ditarik keluar, jadi tidak ada yang bisa disusun ulang.
Alat ini mengatakannya terus terang alih-alih menyerahkan berkas kosong. Kalau hanya sebagian halaman yang berupa pindaian, ia menyebutkan nomor halaman mana saja yang kembali kosong. Membaca teks dari gambar bukan sesuatu yang dilakukan alat ini.
Seluruh konversi terjadi di dalam peramban ini. Membaca PDF dan menulis dokumen baru sama-sama dikerjakan oleh kode yang berjalan di perangkat Anda. Tidak ada langkah unggah sama sekali.
Anda bisa memeriksanya sendiri. Buka tab jaringan di alat pengembang (F12) lalu jalankan konversi: permintaan unggah sebesar berkas Anda entah muncul, entah tidak.
Tidak. Membaca PDF dan menulis berkas Word sama-sama terjadi di dalam peramban ini. Tidak ada akun dan tidak ada yang perlu dipasang.
Tidak. Kalimat, urutan baca, paragraf dan tabel ikut, tetapi letak di halaman tidak direproduksi. Menirunya berarti memaku kotak teks pada koordinat, dan dokumen semacam itu tidak bisa disunting.
Tabel dalam PDF sering tidak bergaris, dan kalaupun ada, garis itu digambar di lapisan berbeda yang tidak pernah terlihat oleh penarikan teks. Maka tabel dicari dengan memeriksa apakah selnya berbaris lurus ke bawah. Jarak kolom yang sempit dan sel gabungan bisa mengacaukannya.
Tidak. Pindaian adalah gambar halaman dan sama sekali tidak memuat teks. Jatuhkan satu dan alat ini akan langsung memberi tahu.
Bisa kalau Anda tahu sandinya. Ketika alat menemui berkas terenkripsi, kotak sandi muncul. Ketik sandinya lalu jalankan lagi.
Tidak ada batas yang dipasang. Tetapi semuanya berjalan di perangkat Anda, jadi dokumen yang sangat panjang memakan waktu sebanding. Komputer menanganinya lebih cepat daripada ponsel.
Anda mengubah sebuah PDF ke Word dan tabelnya keluar miring. Anda mengira konverternya jelek, mencoba yang lain, dan hasilnya kurang lebih sama. Ada masalah yang tidak hilang dengan berganti alat.
Dua situasi: Anda punya file .docx tapi tidak punya Word, atau Word menolak file itu dengan pesan “Word found unreadable content”. Di bawah ini ada program gratis yang bisa membukanya, apa yang diminta masing-masing dari Anda, dan cara mengambil teks dari file yang tidak bisa dibuka oleh satu pun di antaranya.
Anda hanya perlu mengganti satu baris tanggal di kontrak. Dikonversi ke Word, tabel dan marginnya bergeser; diekspor kembali ke PDF, fontnya ikut berubah. Gara-gara satu baris, seluruh dokumen jadi berbeda.