Che cosa sopravvive quando un PDF diventa un file Word
Converti un PDF in Word e la tabella esce storta. Dai la colpa al convertitore, ne provi un altro e ottieni più o meno lo stesso. Ci sono problemi che non si risolvono cambiando strumento.
Capire il perché ti dice quale strumento scegliere e quanto puoi aspettarti.
Un PDF è uno stampato, non un documento
Dentro un PDF c’è un lungo elenco di istruzioni che dicono stampa questo carattere a 72, 680. Da nessuna parte nel file è registrato dove finiva un paragrafo né quali due righe appartenevano alla stessa riga di una tabella.
Quell’informazione viene buttata nel momento in cui un documento viene esportato in PDF, esattamente come un foglio stampato non ne ha bisogno. Riportarlo indietro è quindi una ricostruzione e non una conversione: la forma originale viene dedotta da dove poggiano i caratteri.
Questa sola frase spiega tutto il resto. La tabella esce storta non perché il convertitore l’abbia letta male, ma perché non c’era alcuna tabella da leggere e ha dovuto essere dedotta dalla sola posizione.
Ciò che si deduce e ciò che non c’è mai stato
Separare queste due cose ti dice che cosa può migliorare e che cosa no.
- Deducibile. La divisione in paragrafi, dall’interlinea e da dove le righe si fermano. Le tabelle, dal fatto che le celle restino allineate verso il basso. I titoli, da un corpo più grande del testo. Algoritmi migliori li rendono più precisi.
- Estraibile direttamente. I caratteri stessi, e qualsiasi immagine o timbro stampato sulla pagina. Sono oggetti reali nel file e non serve indovinarli.
- Mai registrato. Quale stile di Word usasse l’originale, dove la tabella avesse celle unite, quanti punti di spazio ci fossero tra i paragrafi. Nessuno strumento può produrli.
Diffida dei convertitori che riproducono l’impaginazione esatta
Alcuni strumenti promettono un risultato identico all’originale pixel per pixel. Lo apri ed è davvero così. Poi modifichi una riga e il documento si sfascia.
Ottenerlo significa mettere il testo in centinaia di caselle fissate a coordinate immobili anziché in paragrafi. Un documento costruito così sembra l’originale ma non ci si può lavorare. Cancella un carattere e solo quella casella si adatta, mentre tutto intorno resta fermo.
| Che cosa ti serve | Che cosa scegliere |
|---|---|
| Leggere e modificare il contenuto | Un convertitore che ricostruisce i paragrafi |
| Solo leggerlo | Non convertire: usa un lettore PDF |
| Deve essere identico allo stampato | Non convertire: tieni il PDF |
| Fare calcoli sui numeri | Converti in foglio di calcolo |
La conversione esiste perché tu possa modificare. Un risultato che non puoi modificare ha perso il suo scopo. Se l’obiettivo è sembrare identico, non c’era motivo di convertire.
Il vero motivo per cui le tabelle escono male
Le tabelle nei PDF molto spesso non hanno alcun filetto. Dove ci sono, quei filetti sono disegnati su un livello diverso dal testo, invisibili a qualunque cosa ne estragga le parole. È per questo che gli approcci basati sul trovare i filetti falliscono così spesso.
Quello che si legge è dunque la posizione: le celle il cui bordo sinistro coincide su più righe vengono prese per una tabella. Il metodo è più debole sulle celle vuote. Una cella vuota non lascia traccia nel file, quindi quella riga sembra averne una in meno e tutto ciò che segue slitta di uno.
Con le celle unite succede lo stesso. Il tuo occhio vede due celle fuse; il file contiene un pezzo di testo che sta un po’ più a sinistra dei vicini.
Nessuno strumento converte un PDF scansionato
Un PDF prodotto da uno scanner da ufficio è una sola fotografia per pagina. I tuoi occhi vedono lettere, il file non ne contiene nessuna. Non è un limite dello strumento ma un’assenza nell’origine.
Il riconoscimento ottico può fabbricare testo a partire dall’immagine. Ma quello è riconoscere e non estrarre, e ci mescola errori come leggere uno zero come la lettera O. In un contratto o in un modulo da consegnare quel tipo di errore costa caro. Chiedere il file originale a chi lo ha emesso di solito è più rapido.
In breve
La domanda da fare a un convertitore non è quanto somiglia, ma se puoi modificare ciò che ne esce. E quando il risultato non è perfetto, saper distinguere un limite dello strumento da un limite del formato ti risparmia di cambiare strumento per niente.
Domande frequenti
- Perché convertitori diversi danno risultati diversi?
- Perché le loro regole di deduzione sono diverse. Quanto deve essere largo uno spazio per contare come fine paragrafo, quante righe allineate contano come tabella: ogni strumento traccia quei confini in un punto leggermente diverso. Per questo uno strumento si adatta a certi documenti meglio di un altro.
- Le mie tabelle escono sempre male. Si può fare qualcosa?
- Più celle vuote ha una tabella, peggio va, perché una cella vuota non lascia traccia nel PDF. Se ti serve solo la tabella, convertire in foglio di calcolo è meglio che in Word. Quella strada fa cadere le celle nelle colonne apposta, e il disallineamento è più facile da sistemare a mano.
- Le immagini e i timbri passano?
- Sì. Sono oggetti reali stampati sulla pagina, quindi non serve indovinarli e vengono estratti così come sono. Dove finiscono lo decide l’ordine di lettura e non le coordinate originali, perché inchiodarli alle coordinate darebbe un documento che non puoi modificare.
- I caratteri sono cambiati.
- Un PDF incorpora davvero i file dei caratteri, ma nulla garantisce che portino il nome indicato dal documento originale, e ancor meno che lo stesso carattere sia installato sulla macchina che apre il risultato. Perciò i caratteri si lasciano stare e si usa quello predefinito.
- Esiste un convertitore che non carica il mio file?
- Sì, gli strumenti di questo sito funzionano così. L’intera conversione finisce dentro il browser, quindi non c’è alcun passaggio di caricamento. Per verificarlo apri la scheda rete negli strumenti per sviluppatori e avvia una conversione.
Aggiornato il 17 settembre 2026