Ouvrir un fichier .docx sans Word, et récupérer le texte quand Word le dit endommagé
Deux situations : vous avez un .docx et pas de Word, ou Word refuse le fichier avec “Word found unreadable content” (Word a trouvé un contenu illisible). Voici les logiciels gratuits qui l’ouvrent, ce que chacun vous demande, et comment récupérer le texte d’un fichier qu’aucun d’eux n’ouvre.
Dans les deux cas, ce qu’il vous faut tout de suite, ce sont en général les mots, pas la mise en page.
Pas de Word sur cet ordinateur : ouvrir un .docx gratuitement
L’abonnement Microsoft 365 a peut-être expiré, Word n’est installé que sur le PC du bureau, vous êtes sur Mac ou sur téléphone, ou votre compte étudiant a pris fin. Vérifiez d’abord une chose. La documentation de Microsoft sur les licences indique que les applications Microsoft 365 sans licence restent installées en “mode de fonctionnalité réduite”, dans lequel “les utilisateurs peuvent seulement afficher et imprimer leurs documents”. Si Word est encore là, un double-clic sur le fichier peut donc toujours l’ouvrir en lecture.
Ou bien les fichiers passent sur un nouvel ordinateur qui n’a jamais eu Word. Un utilisateur de Mac sur Apple Community, après son départ à la retraite :
When I retired, I put personal files on a flash drive. I can download the files, but the doc and docx files will not open. "Cannot open files at this time". I tried opening the files with the LibreOffice, did not work. …
Traduction : “Quand j’ai pris ma retraite, j’ai mis mes fichiers personnels sur une clé USB. Je peux télécharger les fichiers, mais les fichiers doc et docx ne s’ouvrent pas. ‘Cannot open files at this time’ (impossible d’ouvrir les fichiers pour le moment). J’ai essayé de les ouvrir avec LibreOffice, ça n’a pas marché. …” Avril 2021, MacBook Pro sous macOS 10.15.
LibreOffice, la première suggestion habituelle, n’a rien donné ici. Une autre réponse renvoyait vers Pages : “Pages peut ouvrir les documents Word.” Voici la liste complète :
| Option | Ce qu’elle vous demande | Bon à savoir |
|---|---|---|
| Word pour le web | Un compte Microsoft gratuit et un navigateur | Gratuit sur le web, par Microsoft. Ouvrez votre fichier avec la commande d’envoi de fichier (“Upload a file” dans la version anglaise). Les comptes gratuits ont 5 Go de OneDrive. |
| Google Docs | Un compte Google | Importez le fichier dans Drive (Nouveau > Importer un fichier), puis double-cliquez dessus. Accepte les .docx et les .doc plus récents qu’Office 95, jusqu’à 50 Mo une fois convertis. |
| LibreOffice 26.8 | Une installation sous Windows, macOS ou Linux | Gratuit, libre, sorti le 26 août 2026. Lit et écrit le DOCX, hors ligne. |
| Pages | Un Mac, un iPad ou un iPhone | Fichier > Ouvrir. Ouvre les .doc et .docx. Apple indique que Pages reste gratuit ; l’offre payante Creator Studio ajoute des modèles, des médias et des fonctions d’IA. |
| TextEdit | Rien, il est fourni avec macOS | Apple indique qu’il ouvre les documents d’autres traitements de texte, dont Microsoft Word. |
| DOCX en texte, sur ce site | Rien | Texte, Markdown ou HTML uniquement. Voir plus bas. |
Sous Windows, on trouve encore le vieux conseil d’ouvrir le fichier dans WordPad. Ça ne marche pas sur un PC à jour : Microsoft a retiré WordPad de toutes les éditions à partir de Windows 11 version 24H2.
Pour des fichiers professionnels : Word pour le web et Google Docs placent le document dans un compte cloud personnel, ce que votre employeur ou votre client n’autorise pas forcément. LibreOffice, Pages et TextEdit le gardent sur votre ordinateur.
“Word found unreadable content” : ce que veulent dire les messages
Word refuse généralement un fichier en plusieurs messages successifs. Un fil Microsoft Q&A que plus de 300 personnes ont marqué comme leur question aussi en garde la séquence. Les messages ci-dessous sont ceux de la version anglaise :
| Ce que dit Word | Ce que ça vous apprend |
|---|---|
| The file cannot be opened because there are problems with the contents. | Word n’a pas pu lire une partie du fichier. Cliquez sur Détails avant de fermer. |
| Word found unreadable content in "file name". Do you want to recover the contents of this document? If you trust the source of this document, click Yes. | Word propose sa propre réparation. Cliquer sur Oui est le seul moyen de savoir si elle marche. |
| Microsoft Office cannot open this file because some parts are missing or invalid. | La réparation n’a pas réussi à passer l’endroit abîmé. |
Cliquez aussi sur Détails. Dans un autre fil, on y lisait “The name in the end tag element must match the element type in the start tag Location: Part:/word/document.xml, Line: 2, Column: 3479”. Autrement dit, la partie qui contient le texte a une balise cassée à cet endroit précis, ce qui compte pour la section suivante.
Si vous avez Word, l’article de Microsoft sur les documents endommagés propose deux autres pistes. Fichier > Ouvrir, cliquez une fois sur le fichier, cliquez sur la flèche du bouton Ouvrir et choisissez Ouvrir et réparer. Ou, dans la même fenêtre, réglez la liste des types de fichiers sur l’option de récupération du texte (“Recover Text from Any File(*.*)” dans la version anglaise) : la mise en forme, les images et les champs sont perdus, tandis que le texte des champs, les en-têtes, les pieds de page, les notes de bas de page et les notes de fin sont conservés en texte brut.
Un autre logiciel va parfois plus loin, parce qu’il lit le fichier à sa manière. Une réponse dans le même fil, en 2010 :
Recently, in a class of 20 students, it has occurred 5 times for students when creating documents with a Table of Contents or Index. None of the fixes at the support link work. Only opening the file with Open Office allows recovery of some items.
Traduction : “Récemment, dans une classe de 20 élèves, c’est arrivé 5 fois à des élèves qui créaient des documents avec une table des matières ou un index. Aucune des solutions du lien d’assistance ne marche. Seule l’ouverture du fichier avec Open Office permet de récupérer certains éléments.” Réponse dans le fil “File cannot be opened because there are problems with contents”, plus de 300 personnes avec la même question.
Aujourd’hui, ce serait LibreOffice, issu d’OpenOffice. Attendez-vous à “certains éléments”, pas au fichier entier.
Un .docx est un fichier zip : récupérer le texte dans word/document.xml
La documentation Open XML de Microsoft le dit aussi : renommez un .docx en .zip pour voir ses parties, et document.xml “contient le corps principal du document”. Dans le fil sur la balise de fin cassée (plus de 50 personnes avec la même question), un bénévole a répondu :
A Word 2007 docx file is nothing more than a zip package. If you change the extension from .docx to .zip, any zip archiver will be able to open it.
Traduction : “Un fichier docx de Word 2007 n’est rien d’autre qu’une archive zip. Si vous changez l’extension .docx en .zip, n’importe quel logiciel d’archivage zip pourra l’ouvrir.” Réponse à la question “The office Open XML file cannot be opened because there are problems with the content”, juillet 2010.
Sur une copie, jamais sur votre seul exemplaire :
Le texte se trouve dans des éléments <w:t>, donc un long document se lit laborieusement, mais rien n’est caché. Dans nos fichiers de test, les images étaient dans word/media sous forme de fichiers image ordinaires, et les en-têtes, pieds de page et notes de bas de page avaient leurs propres fichiers XML.
Deux limites. Si l’extraction échoue, le zip est incomplet (souvent une pièce jointe ou un téléchargement qui ne s’est jamais terminé) et le texte est parti avec ; récupérez de nouveau le fichier et comparez sa taille avec celle du fichier de l’expéditeur. Et une balise cassée à une ligne et une colonne connues peut être corrigée par quelqu’un d’à l’aise avec le XML, qui recompresse ensuite les parties. C’est la vraie réparation, et ce n’est pas à la portée de tout le monde.
Vous n’avez besoin que du texte ? Extrayez-le dans le navigateur
L’outil DOCX en texte de ce site est fait pour le cas “il me faut juste les mots”. Il lit un .docx à la fois dans votre navigateur, donc rien n’est envoyé, et il fonctionne dans le navigateur d’un téléphone (les gros fichiers sont plus lents). Choisissez texte brut, Markdown ou HTML, vérifiez l’aperçu, puis copiez ou téléchargez. Ce que garde chaque format de sortie, d’après son code et des fichiers de test que nous y avons passés :
| Dans le document | Texte brut | Markdown | HTML |
|---|---|---|---|
| Paragraphes et titres | Gardés, sans mise en forme | Gardés, avec titres #, gras, italique et liens | Gardés sous forme de balises |
| Tableaux | Chaque cellule sur sa propre ligne | Un tableau à barres verticales | Un vrai tableau |
| Images | Supprimées | Intégrées au fichier sous forme de données, ce qui peut l’alourdir | Intégrées de la même façon |
| Notes de bas de page et de fin | Supprimées | Listées à la fin | Listées à la fin |
| En-têtes, pieds de page, commentaires | Supprimés | Supprimés | Supprimés |
| Suivi des modifications | Ajouts gardés, suppressions retirées | Pareil | Pareil |
Ce n’est pas un outil de réparation. Nous avons passé des fichiers de test endommagés dans son analyseur (mammoth 1.12.2). Un fichier coupé en cours de route a échoué avec “Le fichier est tronqué, ou son format ne correspond pas à l’extension.” Un fichier avec une balise non refermée, comme dans le cas de Q&A, a échoué aussi : l’analyseur s’arrête à la première erreur XML. Un fichier au XML valide contenant un élément inattendu a livré tout son texte. L’outil aide donc quand le fichier est intact et qu’un logiciel fait des difficultés, pas quand il manque des octets.
Il ne lit pas non plus les anciens fichiers .doc ni les .docx protégés par mot de passe. Un .docx que nous avons enregistré avec un mot de passe n’était pas du tout un zip, donc le renommer échoue aussi. L’outil reconnaît désormais ces deux cas : il indique qu’il s’agit d’un ancien fichier Word (.doc) ou d’un document protégé par mot de passe, et vous invite à l’ouvrir dans Word ou Google Docs, à retirer le mot de passe et à l’enregistrer en .docx.
Quand rien ne marche
Parfois, toutes les portes sont fermées. Ceci a été publié sur Microsoft Q&A en octobre 2025 :
I have a submission in the next couple of minutes & my Microsoft Word file will not open now. It seemed to be working as expected earlier.
Traduction : “J’ai un rendu dans les toutes prochaines minutes et mon fichier Microsoft Word ne s’ouvre plus. Tout avait l’air de fonctionner normalement tout à l’heure.” Extrait de “URGENT: Microsoft Word found unreadable content in (File Name).”
Un modérateur Microsoft a proposé les pistes de cet article : renommer en .zip et chercher word/document.xml, essayer Google Docs ou LibreOffice, lancer Word en mode sans échec. L’auteur a répondu : “Rien ne marche. Je sors d’un appel avec l’assistance Microsoft. Rien ne marche.” Plus tard dans le mois, quelqu’un a ajouté que son mémoire de master, “de plus de 50 pages”, avait fait la même chose, et qu’un outil de récupération tiers avait échoué lui aussi.
Quand des octets manquent, aucun logiciel ne peut les remettre. Cherchez une autre copie : redemandez le fichier à l’expéditeur, regardez dans vos e-mails envoyés, sur une clé USB ou dans un dossier cloud. Un PDF envoyé par l’expéditeur s’ouvre dans n’importe quel navigateur, et si vous devez à nouveau le modifier sous Word, l’outil PDF en Word de ce site reconstruit ses paragraphes et ses tableaux dans un nouveau .docx. Il lui faut un PDF avec du vrai texte, pas un scan, et la mise en page est reconstruite, pas copiée.
Questions fréquentes
- Est-ce que tout ça marche pour les anciens fichiers .doc ?
- Pas l’extracteur de ce site, qui ne lit que le .docx. Google Docs convertit les fichiers .doc plus récents qu’Office 95, et Pages ouvre aussi les .doc.
- Je dois le renvoyer en .docx après modification.
- Utilisez LibreOffice, qui lit et écrit le DOCX, ou Pages, qui peut enregistrer une copie au format Word. L’extracteur de ce site ne vous donne que du texte.
- Renommer en .zip donne une erreur.
- Le téléchargement est peut-être incomplet, le fichier est peut-être protégé par mot de passe (ce n’est alors pas un zip à l’intérieur), ou c’est un ancien .doc qui porte seulement un nom en .docx.
- Puis-je le faire sur un téléphone ?
- Pages fonctionne sur iPhone et iPad. L’extracteur de ce site fonctionne dans le navigateur d’un téléphone ; les très gros documents prennent un moment.
Mis à jour le 30 septembre 2026 · État au 30 septembre 2026. Vérifié avec LibreOffice 26.8, Pages 15.4 pour Mac (guide d’utilisation d’Apple), Windows 11 version 24H2 et mammoth 1.12.2, l’analyseur utilisé par l’outil DOCX en texte.