Bir PDF Word dosyasına dönüşürken neler hayatta kalır
Bir PDF’i Word’e çeviriyorsunuz ve tablo eğri çıkıyor. Dönüştürücüyü suçlayıp başkasını deniyorsunuz, sonuç aşağı yukarı aynı. Bazı sorunlar araç değiştirerek çözülmez.
Nedenini anlamak hangi aracı seçeceğinizi ve ondan ne kadarını bekleyeceğinizi söyler.
PDF bir çıktıdır, belge değil
Bir PDF’in içinde duran şey, şu karakteri 72, 680 noktasına bas diyen uzun bir komut listesidir. Dosyanın hiçbir yerinde bir paragrafın nerede bittiği ya da hangi iki satırın bir tablonun aynı satırına ait olduğu kayıtlı değildir.
O bilgi, belge PDF olarak dışa aktarıldığı anda atılır; basılmış bir kâğıdın ona ihtiyaç duymaması gibi. Dolayısıyla geri getirmek bir dönüştürme değil yeniden kurmadır: özgün biçim, karakterlerin nereye oturduğundan çıkarsanır.
Bu tek cümle geri kalan her şeyi açıklar. Tablo, dönüştürücü onu yanlış okuduğu için değil, okunacak bir tablo hiç olmadığı ve yalnızca konumdan çıkarsanmak zorunda kalındığı için eğri çıkar.
Çıkarsanabilenler ve hiç var olmayanlar
Bu ikisini ayırmak neyin iyileşebileceğini, neyin iyileşemeyeceğini söyler.
- Çıkarsanabilir. Paragraf ayrımları, satır aralıklarından ve satırların nerede durduğundan. Tablolar, hücrelerin aşağı doğru hizalı kalıp kalmadığından. Başlıklar, gövde metninden büyük puntodan. Daha iyi algoritmalar bunları daha isabetli kılar.
- Doğrudan çıkarılabilir. Karakterlerin kendisi ve sayfaya basılmış her görsel ya da mühür. Bunlar dosyadaki gerçek nesnelerdir, tahmine gerek yoktur.
- Hiç kaydedilmemiş. Özgün belgenin hangi Word biçemini kullandığı, tablonun nerede birleştirilmiş hücresi olduğu, paragraflar arasında kaç punto boşluk bulunduğu. Hiçbir araç bunları üretemez.
Sayfa düzenini birebir yeniden üreten dönüştürücülere kuşkuyla bakın
Bazı araçlar çıktının özgünle piksel piksel örtüştüğünü söyler. Açtığınızda gerçekten de örtüşür. Sonra bir satırı düzenlersiniz ve belge dağılır.
Bunu başarmak, metni paragraflara değil sabit koordinatlara çivilenmiş yüzlerce metin kutusuna koymak demektir. Böyle kurulmuş bir belge özgüne benzer ama içinde çalışılamaz. Bir karakteri silin, yalnızca o kutu yeniden akar, çevresindeki her şey yerinde kalır.
| Neye ihtiyacınız var | Ne seçmeli |
|---|---|
| İçeriği okuyup düzenlemek | Paragrafları yeniden kuran bir dönüştürücü |
| Yalnızca okumak | Dönüştürmeyin, bir PDF okuyucu kullanın |
| Çıktıyla birebir aynı olmalı | Dönüştürmeyin, PDF’i saklayın |
| Sayılarla hesap yapmak | Bir çalışma sayfasına dönüştürün |
Dönüştürme, düzenleyebilesiniz diye vardır. Düzenleyemediğiniz bir çıktı amacını yitirmiştir. Amaç birebir aynı görünmekse, en baştan dönüştürmek için bir sebep yoktu.
Tabloların yanlış çıkmasının gerçek nedeni
PDF’lerdeki tabloların çok sık hiç çizgisi olmaz. Olduğu yerde de o çizgiler metinden farklı bir katmana çizilmiştir ve sözcükleri çıkaran hiçbir şey onları göremez. Çizgi bulmaya dayanan yaklaşımların bu kadar sık başarısız olmasının nedeni budur.
Okunan şey bu yüzden konumdur: sol kenarı birkaç satır boyunca aynı yerde duran hücreler bir tablo sayılır. Yöntem en çok boş hücrelerde zayıflar. Boş bir hücre dosyada iz bırakmaz, o satır bir hücre eksikmiş gibi görünür ve sonrasındaki her şey bir kayar.
Birleştirilmiş hücrelerde de aynısı olur. Gözünüz kaynaşmış iki hücre görür; dosyada ise komşularından biraz daha solda oturan tek bir metin parçası vardır.
Taranmış bir PDF’i hiçbir araç dönüştüremez
Ofis tarayıcısının ürettiği bir PDF, sayfa başına tek bir fotoğraftır. Gözünüz harf görür, dosyada tek bir harf yoktur. Bu aracın sınırı değil, kaynaktaki bir yokluktur.
Optik karakter tanıma, resimden metin imal edebilir. Ama bu çıkarmak değil tanımaktır ve sıfırı O harfi diye okumak gibi hatalar karıştırır. Bir sözleşmede ya da teslim edilecek bir formda o tür hata pahalıya patlar. Belgeyi düzenleyen kurumdan özgün dosyayı istemek genelde daha hızlıdır.
Kısacası
Bir dönüştürücüye sorulacak soru ne kadar benzediği değil, çıkan şeyi düzenleyip düzenleyemediğinizdir. Sonuç kusursuz olmadığında ise, aracın sınırıyla biçimin sınırını ayırt edebilmek sizi boş yere araç değiştirmekten kurtarır.
Sık sorulanlar
- Farklı dönüştürücüler neden farklı sonuç veriyor?
- Çünkü çıkarsama kuralları farklıdır. Bir boşluğun paragraf sonu sayılması için ne kadar geniş olması gerektiği, kaç hizalı satırın tablo sayılacağı: her araç bu sınırları biraz farklı yere çeker. Bu yüzden bir araç kimi belgelere diğerinden daha iyi oturur.
- Tablolarım hep yanlış çıkıyor. Yapılabilecek bir şey var mı?
- Bir tabloda ne kadar çok boş hücre varsa sonuç o kadar kötüdür, çünkü boş hücre PDF’te iz bırakmaz. Yalnızca tablo lazımsa çalışma sayfasına dönüştürmek Word’e dönüştürmekten iyidir. O yol hücreleri bilerek sütunlara düşürür ve kayma elde daha kolay düzeltilir.
- Görseller ve mühürler geçiyor mu?
- Evet. Sayfaya basılmış gerçek nesnelerdir, tahmin gerektirmezler ve oldukları gibi çıkarılırlar. Nereye düşecekleri özgün koordinatlarına göre değil okuma sırasına göre belirlenir; koordinatlara çivilemek düzenleyemeyeceğiniz bir belge verirdi.
- Yazı tipleri değişti.
- PDF gerçekten yazı tipi dosyalarını gömer, ama bunların özgün belgenin belirttiği adı taşıdığının garantisi yoktur, sonucu açan makinede aynı yazı tipinin kurulu olduğunun ise hiç yoktur. Bu yüzden yazı tiplerine dokunulmaz ve varsayılan kullanılır.
- Dosyamı yüklemeyen bir dönüştürücü var mı?
- Evet, bu sitedeki araçlar böyle çalışır. Dönüştürmenin tamamı tarayıcının içinde biter, dolayısıyla yükleme adımı yoktur. Doğrulamak için geliştirici araçlarında ağ sekmesini açıp bir dönüştürme çalıştırın.
Güncellendi 17 Eylül 2026