Ce qui survit quand un PDF devient un fichier Word
Vous convertissez un PDF en Word et le tableau ressort de travers. Vous en concluez que le convertisseur est mauvais, vous en essayez un autre, et le résultat est à peu près le même. Certains problèmes ne disparaissent pas en changeant d’outil.
Comprendre pourquoi vous indique quel outil choisir et ce que vous pouvez en attendre.
Un PDF est un imprimé, pas un document
Ce qui se trouve dans un PDF est une longue liste d’instructions disant imprime ce caractère en 72, 680. Nulle part dans le fichier n’est consigné où se terminait un paragraphe, ni quelles deux lignes appartenaient à la même rangée d’un tableau.
Cette information est jetée au moment même où un document est exporté en PDF, exactement comme une feuille imprimée n’en a pas besoin. Le ramener relève donc de la reconstitution et non de la conversion : la forme d’origine se déduit de l’endroit où se posent les caractères.
Cette seule phrase explique tout le reste. Le tableau ressort de travers non parce que le convertisseur l’a mal lu, mais parce qu’il n’y avait aucun tableau à lire et qu’il a fallu le déduire de la seule position.
Ce qui se déduit et ce qui n’a jamais existé
Séparer ces deux catégories vous dit ce qui peut s’améliorer et ce qui ne le peut pas.
- Déductible. Le découpage en paragraphes, d’après l’interligne et l’endroit où les lignes s’arrêtent. Les tableaux, selon que les cellules restent alignées vers le bas. Les titres, d’après une taille supérieure au corps de texte. De meilleurs algorithmes gagnent en précision.
- Extractible directement. Les caractères eux-mêmes, ainsi que toute image ou tout tampon imprimé sur la page. Ce sont des objets réels du fichier, sans aucune part de devinette.
- Jamais consigné. Quel style Word employait l’original, où le tableau comportait des cellules fusionnées, combien de points d’espacement séparaient les paragraphes. Aucun outil ne peut produire cela.
Méfiez-vous des convertisseurs qui reproduisent la mise en page à l’identique
Certains outils promettent un résultat identique à l’original au pixel près. Vous l’ouvrez : c’est effectivement le cas. Puis vous modifiez une ligne et le document s’effondre.
Y parvenir suppose de placer le texte dans des centaines de zones de texte épinglées à des coordonnées fixes plutôt que dans des paragraphes. Un document bâti ainsi ressemble à l’original mais ne permet pas de travailler. Supprimez un caractère et seule cette zone se réajuste, tout le reste demeure figé.
| Ce qu’il vous faut | Ce qu’il faut choisir |
|---|---|
| Lire et modifier le contenu | Un convertisseur qui reconstitue les paragraphes |
| Seulement le lire | Ne convertissez pas : ouvrez-le dans une visionneuse PDF |
| Coller exactement à l’imprimé | Ne convertissez pas : gardez le PDF |
| Calculer sur les chiffres | Convertissez en feuille de calcul |
La conversion existe pour que vous puissiez modifier. Un résultat que vous ne pouvez pas modifier a perdu sa raison d’être. Si le but est de paraître identique, il n’y avait aucune raison de convertir.
La vraie raison pour laquelle les tableaux ressortent mal
Les tableaux des PDF n’ont très souvent aucun filet. Là où il y en a, ces filets sont tracés sur une couche différente du texte, invisibles pour tout ce qui en extrait les mots. C’est pourquoi les approches fondées sur la détection des filets échouent si souvent.
C’est donc la position qui est lue : les cellules dont le bord gauche coïncide sur plusieurs lignes sont prises pour un tableau. La méthode faiblit sur les cellules vides. Une cellule vide ne laisse aucune trace dans le fichier, la rangée semble donc en compter une de moins et tout ce qui suit se décale d’un cran.
Il en va de même des cellules fusionnées. Votre œil voit deux cellules réunies ; le fichier contient un fragment de texte posé un peu plus à gauche que ses voisins.
Aucun outil ne convertit un PDF scanné
Un PDF issu d’un scanner de bureau contient une seule photographie par page. Vos yeux voient des lettres, le fichier n’en contient aucune. Ce n’est pas une limite de l’outil mais une absence à la source.
La reconnaissance optique peut fabriquer du texte à partir de l’image. Mais c’est reconnaître et non extraire, et cela introduit des erreurs comme lire un zéro pour la lettre O. Dans un contrat ou un formulaire à déposer, ce genre d’erreur coûte cher. Demander le fichier d’origine à l’émetteur est souvent plus rapide.
En résumé
La question à poser à un convertisseur n’est pas à quel point il colle, mais si vous pouvez modifier ce qui en sort. Et quand le résultat n’est pas parfait, savoir distinguer une limite de l’outil d’une limite du format vous évite de changer d’outil pour rien.
Questions fréquentes
- Pourquoi des convertisseurs différents donnent-ils des résultats différents ?
- Parce que leurs règles de déduction diffèrent. Quelle largeur d’écart compte comme fin de paragraphe, combien de lignes alignées comptent pour un tableau : chaque outil place ces seuils un peu différemment. C’est pourquoi tel outil convient mieux à tel type de document.
- Mes tableaux ressortent toujours faux. Peut-on y faire quelque chose ?
- Plus un tableau compte de cellules vides, plus il souffre, car une cellule vide ne laisse aucune trace dans le PDF. Si seul le tableau vous intéresse, convertir en feuille de calcul vaut mieux que convertir en Word. Cette voie répartit délibérément les cellules dans des colonnes, et un décalage se corrige plus facilement à la main.
- Les images et les tampons passent-ils ?
- Oui. Ce sont des objets réels imprimés sur la page : rien à deviner, ils sont extraits tels quels. Leur emplacement suit l’ordre de lecture et non leurs coordonnées d’origine, car les épingler à des coordonnées donnerait un document que vous ne pourriez pas modifier.
- Les polices ont changé.
- Un PDF intègre bien des fichiers de police, mais rien ne garantit qu’ils portent le nom indiqué par le document d’origine, et encore moins que cette même police soit installée sur la machine qui ouvre le résultat. Les polices sont donc laissées de côté et la police par défaut s’applique.
- Existe-t-il un convertisseur qui n’envoie pas mon fichier ?
- Oui, les outils de ce site fonctionnent ainsi. Toute la conversion s’achève dans le navigateur, il n’y a donc aucune étape d’envoi. Pour le vérifier, ouvrez l’onglet réseau des outils de développement et lancez une conversion.
Mis à jour le 17 septembre 2026