Cómo abrir un .docx sin Word, y sacar el texto cuando Word dice que está dañado
Dos situaciones: tienes un .docx y no tienes Word, o Word rechaza el archivo con "Word found unreadable content" (Word encontró contenido que no se puede leer). Aquí tienes los programas gratuitos que lo abren, lo que te pide cada uno y cómo sacar el texto de un archivo que ninguno consigue abrir.
En cualquiera de los dos casos, lo que sueles necesitar en ese momento son las palabras, no la maquetación.
No hay Word en este ordenador: formas gratuitas de abrir un .docx
Puede que la suscripción a Microsoft 365 haya caducado, que Word solo esté en el ordenador del trabajo, que estés en un Mac o en el móvil, o que tu cuenta del centro de estudios se haya cerrado. Primero comprueba una cosa. La documentación de licencias de Microsoft dice que las aplicaciones de Microsoft 365 sin licencia siguen instaladas en "modo de funcionalidad reducida", en el que los usuarios solo pueden ver e imprimir sus documentos. Así que, si Word sigue ahí, hacer doble clic en el archivo puede que aún lo abra para leerlo.
O los archivos pasan a un ordenador nuevo que nunca tuvo Word. Un usuario de Mac en la comunidad de Apple, al jubilarse:
When I retired, I put personal files on a flash drive. I can download the files, but the doc and docx files will not open. "Cannot open files at this time". I tried opening the files with the LibreOffice, did not work. …
Traducción: "Cuando me jubilé, guardé mis archivos personales en una memoria USB. Puedo descargar los archivos, pero los doc y docx no se abren. “Cannot open files at this time” (no se pueden abrir archivos en este momento). Probé a abrirlos con LibreOffice y no funcionó…". Abril de 2021, MacBook Pro con macOS 10.15.
LibreOffice, la primera sugerencia de siempre, no sirvió aquí. Otra respuesta apuntaba a Pages: "Pages puede abrir documentos de Word". Esta es la lista completa:
| Opción | Qué te pide | Conviene saber |
|---|---|---|
| Word para la web | Una cuenta gratuita de Microsoft y un navegador | Microsoft lo ofrece gratis en la web. Abre tu archivo con "Cargar un archivo". Las cuentas gratuitas tienen 5 GB de OneDrive. |
| Documentos de Google | Una cuenta de Google | Súbelo a Drive (Nuevo > Subir archivo) y haz doble clic. Admite .docx y .doc posteriores a Office 95, hasta 50 MB una vez convertido. |
| LibreOffice 26.8 | Instalarlo en Windows, macOS o Linux | Gratuito y de código abierto, publicado el 26 de agosto de 2026. Lee y guarda DOCX, sin conexión. |
| Pages | Un Mac, un iPad o un iPhone | Archivo > Abrir. Abre .doc y .docx. Apple dice que Pages sigue siendo gratis; el Creator Studio de pago añade plantillas, contenido multimedia y funciones de IA. |
| TextEdit | Nada, viene con macOS | Apple dice que abre documentos de otros procesadores de texto, incluido Microsoft Word. |
| DOCX a texto en este sitio | Nada | Solo texto, Markdown o HTML. Más abajo lo explicamos. |
En Windows todavía encontrarás el viejo consejo de abrir el archivo con WordPad. En un PC actualizado no funciona: Microsoft quitó WordPad de todas las ediciones a partir de Windows 11 versión 24H2.
Si son archivos de trabajo: Word para la web y Documentos de Google meten el documento en una cuenta personal en la nube, y puede que tu empresa o tu cliente no lo permitan. LibreOffice, Pages y TextEdit lo dejan en tu ordenador.
"Word found unreadable content": qué significan los mensajes
Word suele rechazar un archivo con una cadena de mensajes. Un hilo de Microsoft Q&A que más de 300 personas marcaron como su misma pregunta recoge la secuencia. Los mensajes están tal y como aparecen en la versión en inglés de Word:
| Lo que dice Word | Lo que te está diciendo |
|---|---|
| The file cannot be opened because there are problems with the contents. | Word no pudo leer una parte del archivo. Haz clic en Detalles (Details) antes de cerrarlo. |
| Word found unreadable content in "file name". Do you want to recover the contents of this document? If you trust the source of this document, click Yes. | Word te ofrece su propia reparación. Pulsar Sí (Yes) es la única manera de saber si funciona. |
| Microsoft Office cannot open this file because some parts are missing or invalid. | La reparación no ha podido superar el daño. |
Haz clic también en Detalles. En otro hilo mostraba "The name in the end tag element must match the element type in the start tag Location: Part:/word/document.xml, Line: 2, Column: 3479". Es decir, la parte que guarda el texto tiene una etiqueta rota justo en ese punto, algo que importa en el siguiente apartado.
Si tienes Word, el artículo de Microsoft sobre documentos dañados propone dos cosas más. Archivo > Abrir, haz clic una vez en el archivo, pulsa la flecha del botón Abrir y elige Abrir y reparar. O, en ese mismo cuadro, pon el tipo de archivo en Recuperar texto de cualquier archivo(*.*): se pierden el formato, los gráficos y los campos, y el texto de los campos, los encabezados, los pies de página, las notas al pie y las notas al final se conservan como texto simple.
A veces otro programa llega más lejos, porque lee el archivo a su manera. Una respuesta en ese mismo hilo, de 2010:
Recently, in a class of 20 students, it has occurred 5 times for students when creating documents with a Table of Contents or Index. None of the fixes at the support link work. Only opening the file with Open Office allows recovery of some items.
Traducción: "Hace poco, en una clase de 20 alumnos, les ha pasado 5 veces al crear documentos con tabla de contenido o índice. Ninguna de las soluciones del enlace de soporte funciona. Solo abrir el archivo con Open Office permite recuperar algunas cosas". Respuesta en "File cannot be opened because there are problems with contents", más de 300 personas con la misma pregunta.
Hoy sería LibreOffice, que nació de OpenOffice. Cuenta con "algunas cosas", no con el archivo entero.
Un .docx es un zip: sacar el texto de word/document.xml
La documentación de Open XML de Microsoft también lo dice: cambia la extensión de un .docx a .zip para ver sus partes, y document.xml contiene el cuerpo principal del documento. En el hilo de la etiqueta de cierre rota (más de 50 personas con la misma pregunta), un voluntario respondió:
A Word 2007 docx file is nothing more than a zip package. If you change the extension from .docx to .zip, any zip archiver will be able to open it.
Traducción: "Un archivo docx de Word 2007 no es más que un paquete zip. Si cambias la extensión de .docx a .zip, cualquier programa de compresión podrá abrirlo". Respuesta a "The office Open XML file cannot be opened because there are problems with the content", julio de 2010.
Siempre sobre una copia, nunca sobre la única que tienes:
El texto está dentro de elementos <w:t>, así que un documento largo se lee despacio, pero no hay nada escondido. En nuestros archivos de prueba, las imágenes estaban en word/media como archivos de imagen normales, y los encabezados, los pies de página y las notas al pie tenían sus propios archivos XML.
Dos límites. Si la descompresión falla, el zip está incompleto (muchas veces un adjunto o una descarga que no terminó) y el texto se ha ido con él; vuelve a conseguir el archivo y compara el tamaño con el que tiene quien te lo envió. Y una etiqueta rota en una línea y columna conocidas la puede arreglar alguien que se maneje con XML, que luego vuelve a comprimir las partes. Esa es la reparación de verdad, y no es trabajo para cualquiera.
¿Solo necesitas el texto? Sácalo en el navegador
La herramienta DOCX a texto de este sitio es para el caso de "solo necesito las palabras". Lee un .docx cada vez dentro de tu navegador, así que no se sube nada, y funciona en el navegador del móvil (los archivos grandes van más lentos). Elige texto plano, Markdown o HTML, revisa la vista previa y luego copia o descarga. Esto es lo que conserva cada salida, según su código y los archivos de prueba que pasamos por ella:
| En el documento | Texto plano | Markdown | HTML |
|---|---|---|---|
| Párrafos y títulos | Se conservan, sin formato | Se conservan, con títulos #, negrita, cursiva y enlaces | Se conservan como etiquetas |
| Tablas | Cada celda en su propia línea | Una tabla con barras verticales | Una tabla de verdad |
| Imágenes | Se pierden | Se incrustan en el archivo como datos, lo que puede hacerlo pesado | Se incrustan igual |
| Notas al pie y notas al final | Se pierden | Se listan al final | Se listan al final |
| Encabezados, pies de página, comentarios | Se pierden | Se pierden | Se pierden |
| Control de cambios | Se conservan las inserciones y se pierden las eliminaciones | Igual | Igual |
No es una herramienta de reparación. Pasamos archivos dañados de prueba por su analizador (mammoth 1.12.2). Un archivo cortado a medias falló con "El archivo está cortado, o su formato no coincide con la extensión". Un archivo con una etiqueta desparejada, como el caso de Q&A, también falló: el analizador se detiene en el primer error de XML. Un archivo con XML válido y un elemento que no esperaba soltó todo su texto. Así que ayuda cuando el archivo está entero y un programa se pone exigente, no cuando faltan bytes.
Tampoco lee los .doc antiguos ni los .docx protegidos con contraseña. Un .docx que guardamos con contraseña ni siquiera era un zip, así que cambiar la extensión también falla. Ahora la herramienta distingue los dos casos: avisa de que es un archivo antiguo de Word (.doc) o un documento con contraseña, y te pide que lo abras en Word o en Documentos de Google, le quites la contraseña y lo guardes como .docx.
Cuando nada funciona
A veces todos los caminos están cerrados. Esto se publicó en Microsoft Q&A en octubre de 2025:
I have a submission in the next couple of minutes & my Microsoft Word file will not open now. It seemed to be working as expected earlier.
Traducción: "Tengo una entrega dentro de un par de minutos y ahora mi archivo de Microsoft Word no se abre. Antes parecía funcionar bien". De "URGENT: Microsoft Word found unreadable content in (File Name)."
Un moderador de Microsoft propuso los caminos de este artículo: cambiar la extensión a .zip y buscar word/document.xml, probar con Documentos de Google o LibreOffice, iniciar Word en modo seguro. La persona contestó: "Nada de eso funciona. Acabo de colgar con el soporte de Microsoft. No funciona nada". Ese mismo mes, alguien añadió que a su trabajo de fin de máster, "de más de 50 páginas", le había pasado lo mismo, y que una herramienta de recuperación de terceros también había fallado.
Cuando faltan bytes, ningún programa puede volver a ponerlos. Busca otra copia: pídesela otra vez a quien te la envió, revisa el correo enviado, una memoria USB o una carpeta en la nube. Un PDF de quien te lo mandó se abre en cualquier navegador y, si necesitas volver a editarlo como Word, la herramienta PDF a Word de este sitio reconstruye sus párrafos y tablas en un .docx nuevo. Necesita un PDF con texto de verdad, no un escaneo, y la maquetación se reconstruye, no se copia.
Preguntas frecuentes
- ¿Sirve algo de esto para los .doc antiguos?
- El extractor de este sitio no, porque solo lee .docx. Documentos de Google convierte los .doc posteriores a Office 95, y Pages también abre .doc.
- Tengo que devolverlo como .docx después de editarlo.
- Usa LibreOffice, que lee y guarda DOCX, o Pages, que puede guardar una copia en formato Word. El extractor de aquí solo te da texto.
- Al cambiar la extensión a .zip sale un error.
- Puede que la descarga esté incompleta, que el archivo tenga contraseña (entonces por dentro no es un zip) o que sea un .doc antiguo que solo tiene el nombre de .docx.
- ¿Puedo hacerlo en el móvil?
- Pages funciona en iPhone y iPad. El extractor de aquí funciona en el navegador del móvil; los documentos muy grandes tardan un rato.
Actualizado 30 de septiembre de 2026 · Datos a 30 de septiembre de 2026. Comprobados con LibreOffice 26.8, Pages 15.4 para Mac (guía de uso de Apple), Windows 11 versión 24H2 y mammoth 1.12.2, el analizador que usa la herramienta DOCX a texto.