Memindahkan tabel dari PDF ke Excel
Ada tabel di sebuah PDF laporan dan Anda perlu menghitung dengan angka-angka itu. Anda sorot, salin, tempel ke Excel, dan semua nilai mendarat di satu sel di kolom A. Akhirnya Anda mengetiknya ulang satu per satu.
Jatuhkan sebuah PDF dan nilai yang berdiri dalam kolom seperti tabel dipecah menjadi sel. Tiap halaman menjadi lembarnya sendiri, jadi Anda tidak pernah kehilangan jejak dari mana sebuah angka berasal.
Tanpa unggah
PDF yang akan diubah
PDF harus berisi teks sungguhan. PDF hasil pindai adalah gambar halaman, jadi tidak ada teks yang bisa diambil. Berkas hanya dibuka di browser ini dan tidak pernah diunggah.
Urutan baca, paragraf, dan tabel ikut dipindahkan. Posisi persisnya di halaman tidak. PDF tidak pernah mencatat mana paragraf dan mana tabel, jadi keduanya disusun ulang dari letak karakter-karakternya.
Gambar, stempel, dan tanda tangan yang tercetak di halaman juga ikut dibawa. Kalau mengambang di atas sel, perhitungan jadi terganggu, jadi semuanya dikumpulkan di bawah data pada tiap lembar kerja.
PDF hasil pindai berisi foto, bukan teks, jadi tidak ada yang bisa diubah. Masukkan saja berkasnya, alat ini akan langsung memberi tahu.
Halaman tidak ditempel utuh sebagai gambar. Berkas yang Anda unduh terbuka sebagai dokumen yang bisa diedit di Word atau Excel.
Semakin mirip tabel dokumennya, semakin baik hasilnya. Beberapa sekaligus juga boleh.
Letak karakter menentukan di mana tiap tabel dimulai dan berakhir.
Terbuka di Excel atau Google Spreadsheet siap dihitung.
Tabel dalam PDF sangat sering sama sekali tidak bergaris. Kalaupun ada garisnya, garis itu digambar di lapisan yang berbeda dari teks, tak terlihat oleh apa pun yang menarik kata keluar. Itulah sebabnya pendekatan yang dibangun di atas pencarian garis begitu sering gagal.
Jadi posisilah yang dibaca. Dalam satu baris, jarak yang jauh lebih lebar daripada spasi antarkata berarti batas sel, dan ketika jarak itu berdiri pada posisi mendatar yang sama di beberapa baris berturut-turut, blok itu adalah tabel. Tiga baris adalah batas minimum. Blok dua baris biasanya judul dengan tanggal yang didorong ke ujung kanan, dan menjadikannya tabel justru mempersulit pembacaan.
Sel kosong tidak meninggalkan jejak di berkas, karena di situ memang tidak pernah ada karakter. Menyambung sel berurutan akan menggeser semuanya satu langkah, jadi tiap sel dijatuhkan ke kolom terdekat dan sisanya dibiarkan kosong.
Ketika tabel tersebar di beberapa halaman, menumpuknya ke satu lembar menghilangkan jejak dari halaman mana sebuah angka berasal. Maka tiap halaman menjadi lembarnya sendiri, dinamai menurut nomor halaman.
Baris yang bukan bagian tabel juga disimpan, satu per baris. Membuang judul di atas tabel, atau catatan tentang satuan angkanya, menyisakan angka tanpa cara membacanya. Gambar dan stempel yang tercetak di halaman ikut masuk juga, dikumpulkan di bawah data pada tiap lembar supaya tidak melayang di atas sel dan mengganggu perhitungan.
PDF yang dibuat dengan memotret kertas atau melewatkannya di mesin pindai adalah satu gambar untuk tiap halaman. Mata Anda melihat huruf, tetapi berkasnya tidak memuat satu pun. Tidak ada yang bisa ditarik keluar, jadi tidak ada yang bisa disusun ulang.
Alat ini mengatakannya terus terang alih-alih menyerahkan berkas kosong. Kalau hanya sebagian halaman yang berupa pindaian, ia menyebutkan nomor halaman mana saja yang kembali kosong. Membaca teks dari gambar bukan sesuatu yang dilakukan alat ini.
Seluruh konversi terjadi di dalam peramban ini. Membaca PDF dan menulis dokumen baru sama-sama dikerjakan oleh kode yang berjalan di perangkat Anda. Tidak ada langkah unggah sama sekali.
Anda bisa memeriksanya sendiri. Buka tab jaringan di alat pengembang (F12) lalu jalankan konversi: permintaan unggah sebesar berkas Anda entah muncul, entah tidak.
Tidak. Membaca PDF dan menulis lembar kerja sama-sama terjadi di dalam peramban ini.
Ya, satu baris per baris di kolom pertama. Membuang judul di atas tabel, atau satuan angkanya, akan menyisakan angka yang tak seorang pun bisa menafsirkan.
Itu terjadi karena sel kosong tidak meninggalkan jejak di PDF. Menjatuhkan tiap sel ke kolom terdekat sangat mengurangi hal itu, tetapi tabel dengan jarak kolom yang sangat sempit masih bisa melenceng.
Sel gabungan tidak dibawa serta. Nilai dari blok gabungan mendarat di kolom tunggal mana pun yang paling dekat.
PDF tidak mencatat apakah sebuah nilai berupa angka atau label, jadi disimpan persis seperti tampilannya. Pemisah ribuan dan simbol mata uang membuat Excel membacanya sebagai teks. Mengubah format sel di Excel akan memperbaikinya.
Tidak. Pindaian adalah gambar halaman dan tidak punya teks untuk ditarik.
Ada tabel di sebuah PDF laporan dan Anda perlu menghitung dengan angka-angka itu. Anda sorot, salin, tempel ke Excel, dan semua nilai mendarat di satu sel di kolom A. Akhirnya Anda mengetiknya ulang satu per satu.
Anda mengubah sebuah PDF ke Word dan tabelnya keluar miring. Anda mengira konverternya jelek, mencoba yang lain, dan hasilnya kurang lebih sama. Ada masalah yang tidak hilang dengan berganti alat.