Como abrir um .docx sem Word, e tirar o texto quando o Word diz que o arquivo está corrompido

Duas situações: você tem um .docx e não tem Word, ou o Word recusa o arquivo com "Word found unreadable content" (o Word encontrou conteúdo que não pode ser lido). Veja abaixo os programas gratuitos que abrem o arquivo, o que cada um pede de você e como tirar o texto de um arquivo que nenhum deles abre.

Ashton
Formatos

Nos dois casos, o que você geralmente precisa naquela hora são as palavras, não a formatação.

Não tem Word neste computador: jeitos gratuitos de abrir um .docx

Talvez a assinatura do Microsoft 365 tenha vencido, o Word esteja só no computador do trabalho, você esteja num Mac ou no celular, ou a sua conta da faculdade tenha sido encerrada. Primeiro, confira uma coisa. A documentação de licenciamento da Microsoft diz que os aplicativos do Microsoft 365 sem licença continuam instalados em "modo de funcionalidade reduzida", em que os usuários só podem visualizar e imprimir seus documentos. Então, se o Word ainda está lá, dar dois cliques no arquivo pode abri-lo para leitura.

Ou os arquivos vão para um computador novo que nunca teve Word. Um usuário de Mac na comunidade da Apple, depois de se aposentar:

When I retired, I put personal files on a flash drive. I can download the files, but the doc and docx files will not open. "Cannot open files at this time". I tried opening the files with the LibreOffice, did not work. …

Tradução: "Quando me aposentei, coloquei meus arquivos pessoais num pen drive. Consigo baixar os arquivos, mas os doc e docx não abrem. “Cannot open files at this time” (não é possível abrir os arquivos no momento). Tentei abrir com o LibreOffice e não deu certo…". Abril de 2021, MacBook Pro com macOS 10.15.

Apple Community

O LibreOffice, a primeira sugestão de sempre, não ajudou aqui. Outra resposta apontou o Pages: "O Pages abre documentos do Word". Esta é a lista completa:

OpçãoO que pede de vocêBom saber
Word para a webUma conta Microsoft gratuita e um navegadorGratuito na web, oferecido pela própria Microsoft. Abra o arquivo com "Carregar um arquivo". Contas gratuitas têm 5 GB de OneDrive.
Documentos GoogleUma conta GoogleEnvie para o Drive (Novo > Upload de arquivo) e dê dois cliques. Aceita .docx e .doc mais novos que o Office 95, até 50 MB depois de convertido.
LibreOffice 26.8Instalação no Windows, macOS ou LinuxGratuito e de código aberto, lançado em 26 de agosto de 2026. Lê e grava DOCX, sem internet.
PagesUm Mac, iPad ou iPhoneArquivo > Abrir. Abre .doc e .docx. A Apple diz que o Pages continua gratuito; o Creator Studio pago acrescenta modelos, mídia e recursos de IA.
TextEditNada, já vem no macOSA Apple diz que ele abre documentos de outros processadores de texto, inclusive o Microsoft Word.
DOCX para texto neste siteNadaSó texto, Markdown ou HTML. Veja abaixo.

No Windows você ainda vai achar o velho conselho de abrir o arquivo no WordPad. Num PC atualizado isso não funciona: a Microsoft removeu o WordPad de todas as edições a partir do Windows 11 versão 24H2.

Para arquivos de trabalho: o Word para a web e o Documentos Google colocam o documento numa conta pessoal na nuvem, o que a sua empresa ou o seu cliente talvez não permitam. LibreOffice, Pages e TextEdit mantêm o arquivo no seu computador.

"Word found unreadable content": o que as mensagens querem dizer

O Word costuma recusar um arquivo com uma sequência de mensagens. Um tópico do Microsoft Q&A que mais de 300 pessoas marcaram como a mesma dúvida registra essa sequência. As mensagens estão como aparecem na versão em inglês do Word:

O que o Word dizO que isso significa
The file cannot be opened because there are problems with the contents.O Word não conseguiu ler uma parte do arquivo. Clique em Detalhes (Details) antes de fechar.
Word found unreadable content in "file name". Do you want to recover the contents of this document? If you trust the source of this document, click Yes.O Word está oferecendo o próprio reparo. Clicar em Sim (Yes) é o único jeito de saber se funciona.
Microsoft Office cannot open this file because some parts are missing or invalid.O reparo não conseguiu passar do dano.

Clique também em Detalhes. Em outro tópico, apareceu "The name in the end tag element must match the element type in the start tag Location: Part:/word/document.xml, Line: 2, Column: 3479". Ou seja, a parte que guarda o texto tem uma tag quebrada exatamente nesse ponto, o que importa na próxima seção.

Se você tem o Word, o artigo da Microsoft sobre documentos danificados sugere mais duas coisas. Arquivo > Abrir, clique uma vez no arquivo, clique na seta do botão Abrir e escolha Abrir e Reparar. Ou, nessa mesma janela, mude o tipo de arquivo para Recuperar Texto de Qualquer Arquivo(*.*): formatação, elementos gráficos e campos se perdem, enquanto o texto dos campos, cabeçalhos, rodapés, notas de rodapé e notas de fim ficam como texto simples.

Às vezes outro programa vai mais longe, porque lê o arquivo do seu próprio jeito. Uma resposta no mesmo tópico, de 2010:

Recently, in a class of 20 students, it has occurred 5 times for students when creating documents with a Table of Contents or Index. None of the fixes at the support link work. Only opening the file with Open Office allows recovery of some items.

Tradução: "Recentemente, numa turma de 20 alunos, isso aconteceu 5 vezes com alunos criando documentos com sumário ou índice. Nenhuma das soluções do link de suporte funciona. Só abrir o arquivo no Open Office permite recuperar algumas coisas". Resposta em "File cannot be opened because there are problems with contents", mais de 300 pessoas com a mesma dúvida.

Microsoft Q&A

Hoje, isso seria o LibreOffice, que nasceu do OpenOffice. Espere "algumas coisas", não o arquivo inteiro.

Um .docx é um zip: tirando o texto de word/document.xml

A documentação de Open XML da Microsoft também diz isso: mude a extensão de um .docx para .zip para ver as partes dele, e o document.xml contém o corpo principal do documento. No tópico da tag de fechamento quebrada (mais de 50 pessoas com a mesma dúvida), um voluntário respondeu:

A Word 2007 docx file is nothing more than a zip package. If you change the extension from .docx to .zip, any zip archiver will be able to open it.

Tradução: "Um arquivo docx do Word 2007 não passa de um pacote zip. Se você mudar a extensão de .docx para .zip, qualquer programa de compactação vai conseguir abrir". Resposta a "The office Open XML file cannot be opened because there are problems with the content", julho de 2010.

Microsoft Q&A

Sempre numa cópia, nunca na única que você tem:

Copie o .docx
Mude a extensão da cópia para .zip
Extraia
Abra word/document.xml num editor de texto
Leia o que está entre <w:t> e </w:t>
Se você não vê ".docx" no fim do nome, as extensões estão ocultas; ative a exibição no Explorador de Arquivos.

O texto fica dentro de elementos <w:t>, então um documento longo é lento de ler, mas nada fica escondido. Nos nossos arquivos de teste, as imagens estavam em word/media como arquivos de imagem comuns, e cabeçalhos, rodapés e notas de rodapé tinham arquivos XML próprios.

Dois limites. Se a extração falhar, o zip está incompleto (muitas vezes um anexo ou download que não terminou) e o texto foi junto; pegue o arquivo de novo e compare o tamanho com o de quem enviou. E uma tag quebrada numa linha e coluna conhecidas pode ser corrigida por alguém que entende de XML, que depois compacta as partes de novo. Esse é o reparo de verdade, e não é trabalho para qualquer um.

Só precisa do texto? Extraia no navegador

A ferramenta DOCX para texto deste site é para o caso "só preciso das palavras". Ela lê um .docx por vez dentro do seu navegador, então nada é enviado, e funciona no navegador do celular (arquivos grandes demoram mais). Escolha texto simples, Markdown ou HTML, confira a pré-visualização e depois copie ou baixe. O que cada saída mantém, pela leitura do código e pelos arquivos de teste que passamos por ela:

No documentoTexto simplesMarkdownHTML
Parágrafos e títulosMantidos, sem formataçãoMantidos, com títulos #, negrito, itálico e linksMantidos como tags
TabelasCada célula numa linha própriaUma tabela com barras verticaisUma tabela de verdade
ImagensRemovidasEmbutidas no arquivo como dados, o que pode deixá-lo grandeEmbutidas do mesmo jeito
Notas de rodapé e notas de fimRemovidasListadas no fimListadas no fim
Cabeçalhos, rodapés, comentáriosRemovidosRemovidosRemovidos
Controle de alteraçõesInserções mantidas, exclusões removidasIgualIgual

Não é uma ferramenta de reparo. Passamos arquivos danificados de teste pelo analisador dela (mammoth 1.12.2). Um arquivo cortado no meio falhou com "O arquivo está incompleto, ou o formato não corresponde à extensão". Um arquivo com uma tag sem par, como no caso do Q&A, também falhou: o analisador para no primeiro erro de XML. Um arquivo com XML válido e um elemento que ele não esperava entregou todo o texto. Ou seja, ela ajuda quando o arquivo está inteiro e um programa está sendo exigente, não quando faltam bytes.

Ela também não lê arquivos .doc antigos nem .docx protegidos por senha. Um .docx que salvamos com senha nem era um zip, então renomear também falha. Agora a ferramenta reconhece os dois casos: avisa que é um arquivo antigo do Word (.doc) ou um documento com senha e pede que você abra o arquivo no Word ou no Documentos Google, remova a senha e salve como .docx.

Extrair o texto de um .docx

Quando nada funciona

Às vezes todos os caminhos estão fechados. Isto foi publicado no Microsoft Q&A em outubro de 2025:

I have a submission in the next couple of minutes & my Microsoft Word file will not open now. It seemed to be working as expected earlier.

Tradução: "Tenho uma entrega daqui a poucos minutos e agora meu arquivo do Microsoft Word não abre. Mais cedo parecia estar funcionando normalmente". De "URGENT: Microsoft Word found unreadable content in (File Name)."

Microsoft Q&A

Um moderador da Microsoft sugeriu os caminhos deste artigo: mudar a extensão para .zip e procurar o word/document.xml, tentar o Documentos Google ou o LibreOffice, iniciar o Word no modo de segurança. A pessoa respondeu: "Nada disso está funcionando. Acabei de desligar uma ligação com o suporte da Microsoft. Nada funciona". Mais tarde, naquele mesmo mês, outra pessoa contou que a dissertação de mestrado, "com mais de 50 páginas", tinha dado o mesmo problema, e que uma ferramenta de recuperação de terceiros também tinha falhado.

Quando faltam bytes, nenhum programa consegue colocá-los de volta. Procure outra cópia: peça de novo a quem enviou, veja os e-mails enviados, um pen drive ou uma pasta na nuvem. Um PDF enviado pelo remetente abre em qualquer navegador e, se você precisar editar como Word de novo, a ferramenta PDF para Word deste site reconstrói os parágrafos e tabelas num .docx novo. Ela precisa de um PDF com texto de verdade, não uma digitalização, e o layout é reconstruído, não copiado.

Transformar um PDF de volta em arquivo Word

Perguntas frequentes

Algo disso funciona com arquivos .doc antigos?
O extrator deste site não, porque só lê .docx. O Documentos Google converte .doc mais novos que o Office 95, e o Pages também abre .doc.
Preciso devolver como .docx depois de editar.
Use o LibreOffice, que lê e grava DOCX, ou o Pages, que pode salvar uma cópia no formato Word. O extrator daqui só entrega texto.
Renomear para .zip dá erro.
O download pode estar incompleto, o arquivo pode ter senha (aí por dentro ele não é um zip) ou pode ser um .doc antigo que só tem nome de .docx.
Dá para fazer isso no celular?
O Pages roda no iPhone e no iPad. O extrator daqui roda no navegador do celular; documentos muito grandes demoram um pouco.

Atualizado em 30 de setembro de 2026 · Informações de 30 de setembro de 2026. Conferidas com o LibreOffice 26.8, o Pages 15.4 para Mac (manual da Apple), o Windows 11 versão 24H2 e o mammoth 1.12.2, o analisador usado pela ferramenta DOCX para texto.