PDF’teki tabloyu Excel’e almak
Rapor PDF’inde bir tablo var ve o rakamlarla hesap yapmanız gerekiyor. Seçip kopyalıyor, Excel’e yapıştırıyorsunuz ve bütün değerler A sütunundaki tek bir hücreye düşüyor. Sonunda elle yeniden yazıyorsunuz.
Bir PDF bırakın, tablo gibi sütunlar hâlinde duran değerler hücrelere bölünsün. Her sayfa kendi çalışma sayfası olur, böylece bir sayının nereden geldiğini asla kaybetmezsiniz.
Yükleme yok
Dönüştürülecek PDF
PDF’in içinde gerçek metin olmalı. Taranmış bir PDF sayfanın fotoğrafıdır, çıkarılacak metin yoktur. Dosyalar yalnızca bu tarayıcıda açılır ve hiçbir yere yüklenmez.
Okuma sırası, paragraflar ve tablolar aktarılır. Sayfadaki tam yerleşim aktarılmaz. PDF neyin paragraf, neyin tablo olduğunu hiç kaydetmez; ikisi de karakterlerin durduğu yere bakılarak yeniden kurulur.
Sayfada basılı görseller, mühürler ve imzalar da aktarılır. Hücrelerin üzerinde durmaları hesaplamayı engelleyeceği için her çalışma sayfasında verilerin altında toplanırlar.
Taranmış bir PDF metin değil fotoğraf taşır, dolayısıyla dönüştürülecek bir şey yoktur. Dosyayı bırakın, araç hemen söyler.
Sayfalar bütün hâlinde görsel olarak yapıştırılmaz. İndirdiğiniz dosya Word veya Excel’de düzenlenebilir bir belge olarak açılır.
Belge ne kadar tablo biçimindeyse sonuç o kadar iyi olur. Aynı anda birkaç tane olması sorun değil.
Karakterlerin nereye oturduğu, her tablonun nerede başlayıp nerede bittiğine karar verir.
Excel’de ya da Google E-Tablolar’da hesaplamaya hazır açılır.
PDF’lerdeki tabloların çevresinde çok sık hiç çizgi bulunmaz. Bulunduğu yerde de o çizgiler metinden farklı bir katmana çizilmiştir ve sözcükleri çıkaran hiçbir şey onları göremez. Çizgi bulmaya dayanan yaklaşımların bu kadar sık başarısız olmasının nedeni budur.
Okunan şey bu yüzden konumdur. Bir satır içinde, sözcük arasındaki boşluktan çok daha geniş bir aralık bir hücre sınırı demektir; bu aralıklar art arda gelen birkaç satırda aynı yatay konumda durduğunda o öbek bir tablodur. En az üç satır gerekir. İki satırlık öbekler genellikle sağa itilmiş bir tarihle birlikte bir başlıktır ve onu tabloya çevirmek okumayı kolaylaştırmaz, zorlaştırır.
Boş bir hücre dosyada hiçbir iz bırakmaz, çünkü orada hiç karakter olmamıştır. Hücreleri sırayla eklemek her şeyi bir kaydırır; bu yüzden her hücre kendisine en yakın sütuna düşürülür ve geri kalanlar boş bırakılır.
Tablolar birkaç sayfaya dağılmışken hepsini tek bir çalışma sayfasına yığmak, bir rakamın hangi sayfadan geldiğinin izini kaybettirir. Bu yüzden her sayfa, numarasıyla adlandırılmış kendi çalışma sayfası olur.
Tabloya ait olmayan satırlar da korunur, satır başına bir tane. Tablonun üstündeki başlığı ya da rakamların hangi birimde olduğunu söyleyen notu atmak, elinizde okunacak yolu olmayan sayılar bırakır. Sayfaya basılmış görseller ve mühürler de aktarılır; hücrelerin üzerinde durup hesaplamayı engellemesinler diye her çalışma sayfasında verilerin altında toplanır.
Kâğıdın fotoğrafını çekerek ya da bir ofis tarayıcısından geçirerek elde edilen PDF, sayfa başına tek bir resimdir. Gözünüz harf görür ama dosyada tek bir harf yoktur. Çıkarılacak bir şey olmadığı için yeniden kurulacak bir şey de yoktur.
Araç size boş bir dosya tutuşturmak yerine bunu açıkça söyler. Yalnızca bazı sayfalar taramaysa, hangi sayfa numaralarının boş döndüğünü belirtir. Resimlerin içinden metin okumak bu aracın yaptığı bir iş değildir.
Dönüştürmenin tamamı bu tarayıcının içinde olur. PDF’i okumayı da yeni belgeyi yazmayı da cihazınızda çalışan kod yapar. Yükleme diye bir adım hiç yoktur.
Bunu kendiniz doğrulayabilirsiniz. Geliştirici araçlarında (F12) ağ sekmesini açıp bir dönüştürme çalıştırın: dosyanız büyüklüğünde bir yükleme isteği ya görünür ya görünmez.
Hayır. PDF’i okumak da çalışma sayfasını yazmak da bu tarayıcının içinde olur.
Evet, ilk sütunda satır başına bir tane. Tablonun üstündeki başlığı ya da rakamların birimini atmak, kimsenin yorumlayamayacağı sayılar bırakırdı.
Bu, boş bir hücrenin PDF’te iz bırakmamasından olur. Her hücreyi en yakın sütuna düşürmek bunu epey azaltır, ama sütun aralıkları çok dar olan tablolar yine de kaymış çıkabilir.
Birleştirilmiş hücreler aktarılmaz. Birleştirilmiş bir öbekteki değer, en yakın tek sütuna iner.
PDF bir değerin sayı mı yoksa etiket mi olduğunu kaydetmez, bu yüzden göründüğü gibi saklanır. Binlik ayıraçlar ve para birimi simgeleri Excel’in onu metin olarak okumasına yol açar. Excel’de hücre biçimini değiştirmek sorunu çözer.
Hayır. Tarama, sayfanın resmidir ve çıkarılacak metni yoktur.
Rapor PDF’inde bir tablo var ve o rakamlarla hesap yapmanız gerekiyor. Seçip kopyalıyor, Excel’e yapıştırıyorsunuz ve bütün değerler A sütunundaki tek bir hücreye düşüyor. Sonunda elle yeniden yazıyorsunuz.
Bir PDF’i Word’e çeviriyorsunuz ve tablo eğri çıkıyor. Dönüştürücüyü suçlayıp başkasını deniyorsunuz, sonuç aşağı yukarı aynı. Bazı sorunlar araç değiştirerek çözülmez.