没有 Word 怎么打开 .docx,以及 Word 说文件损坏时怎么把文字取出来

两种情况:手里有个 .docx,却没有 Word;或者 Word 报出「Word found unreadable content」,拒绝打开。下面列出能免费打开它的软件、各自需要什么条件,以及哪个都打不开时,怎么把文字取出来。

Ashton
格式

不管是哪种情况,你眼下需要的往往是里面的文字,而不是排版。

这台电脑没有 Word:免费打开 .docx 的办法

可能是 Microsoft 365 订阅到期了,Word 只装在公司电脑上,你用的是 Mac 或手机,或者学校账号停用了。先确认一件事。Microsoft 的许可文档说,没有许可证的 Microsoft 365 应用仍然留在电脑上,进入“缩减功能模式”,在这种模式下“用户只能查看和打印其文档”。所以如果 Word 还在,双击文件也许仍能以只读方式打开。

也可能是文件搬到了一台从没装过 Word 的新电脑上。一位退休的 Mac 用户在 Apple Community 上写道:

When I retired, I put personal files on a flash drive. I can download the files, but the doc and docx files will not open. "Cannot open files at this time". I tried opening the files with the LibreOffice, did not work. …

译文:“退休的时候,我把个人文件存进了 U 盘。文件能拷出来,可 doc 和 docx 文件打不开,提示「Cannot open files at this time」(目前无法打开文件)。我试过用 LibreOffice 打开,也不行。……”2021 年 4 月,MacBook Pro,macOS 10.15。

Apple Community

通常第一个被推荐的 LibreOffice,在这里没帮上忙。另一条回复提到了 Pages 文稿:“Pages 能打开 Word 文档。”完整的选项如下:

办法需要什么值得知道的
网页版 Word一个免费的 Microsoft 账户和浏览器Microsoft 在网页上免费提供。用「上传文件」打开你的文件。免费账户有 5 GB OneDrive 空间。
Google 文档一个 Google 账号上传到云端硬盘(「新建」>「上传文件」),然后双击。支持 .docx 和比 Office 95 新的 .doc,转换时上限 50 MB。
LibreOffice 26.8在 Windows、macOS 或 Linux 上安装免费、开源,2026 年 8 月 26 日发布。能读写 DOCX,离线可用。
Pages 文稿一台 Mac、iPad 或 iPhone「文件」>「打开」。能打开 .doc 和 .docx。Apple 说 Pages 文稿继续免费;付费的 Creator Studio 会增加模板、素材和 AI 功能。
文本编辑什么都不用,macOS 自带Apple 说它能打开其他文字处理软件(包括 Microsoft Word)创建的文稿。
本站的 DOCX 转文本什么都不用只能得到纯文本、Markdown 或 HTML。见下文。

在 Windows 上,你还会看到用写字板打开的老建议。这在更新到最新的电脑上行不通:从 Windows 11 24H2 版本起,Microsoft 已经在所有版本中移除了写字板。

如果是工作文件:网页版 Word 和 Google 文档会把文档放进个人云账户,你的单位或客户未必允许。LibreOffice、Pages 文稿和文本编辑则让文件留在你自己的电脑上。

「Word found unreadable content」:这些提示是什么意思

Word 拒绝一个文件时,通常会连着弹出几条提示。Microsoft Q&A 上一个有 300 多人标记为同样问题的帖子,记下了完整的顺序。以下是英文版的原文:

Word 显示的内容它说明了什么
The file cannot be opened because there are problems with the contents.Word 读不了文件的一部分。关掉之前,先点 Details(详细信息)。
Word found unreadable content in "file name". Do you want to recover the contents of this document? If you trust the source of this document, click Yes.Word 提出用它自己的方法修复。能不能成功,只有点 Yes 才知道。
Microsoft Office cannot open this file because some parts are missing or invalid.修复没能越过损坏的地方。

Details 也要点开看看。在另一个帖子里,它显示的是「The name in the end tag element must match the element type in the start tag Location: Part:/word/document.xml, Line: 2, Column: 3479」。意思是存放正文的那部分,恰好在这个位置有一个坏掉的标签,这在下一节会派上用场。

如果你有 Word,Microsoft 关于损坏文档的文章还给了两个办法。「文件」>「打开」,单击一下这个文件,点「打开」按钮上的箭头,选 Open and Repair(打开并修复的那一项)。或者在这个对话框里把文件类型设为 Recover Text from Any File(*.*)(从任意文件恢复文本的那一项):格式、图形和域会丢失,但域里的文字、页眉、页脚、脚注和尾注会作为纯文本保留下来。

换一个软件,有时能读得更远,因为它用自己的方式解析文件。同一个帖子里 2010 年的一条回复:

Recently, in a class of 20 students, it has occurred 5 times for students when creating documents with a Table of Contents or Index. None of the fixes at the support link work. Only opening the file with Open Office allows recovery of some items.

译文:“最近在一个 20 人的班上,学生做带目录或索引的文档时,这种情况出现了 5 次。支持链接里的修复方法全都不管用。只有用 Open Office 打开文件,才能救回一部分内容。”出自帖子“File cannot be opened because there are problems with contents”中的回复,有 300 多人标记为同样的问题。

Microsoft Q&A

放到今天,这个角色就是从 OpenOffice 发展而来的 LibreOffice。要做好心理准备:救回的是“一部分内容”,而不是整个文件。

.docx 其实是个 ZIP:从 word/document.xml 里取文字

Microsoft 的 Open XML 文档里也这么写:把 .docx 改名成 .zip 就能看到里面的各个部件,其中 document.xml“包含文档正文的内容”。在那个结束标签损坏的帖子里(50 多人标记为同样的问题),一位志愿者回答说:

A Word 2007 docx file is nothing more than a zip package. If you change the extension from .docx to .zip, any zip archiver will be able to open it.

译文:“Word 2007 的 docx 文件不过是一个 ZIP 包。把扩展名从 .docx 改成 .zip,任何压缩软件都能打开它。”出自对提问“The office Open XML file cannot be opened because there are problems with the content”的回答,2010 年 7 月。

Microsoft Q&A

一定要在副本上做,千万别拿唯一的那份来试:

复制一份 .docx
把副本改名为 .zip
解压
用文本编辑器打开 word/document.xml
读 <w:t> 和 </w:t> 之间的内容
如果文件名末尾看不到“.docx”,说明扩展名被隐藏了,先在文件资源管理器里把它显示出来。

文字都放在 <w:t> 元素里,长文档读起来很费劲,但什么都没藏起来。在我们的测试文件里,图片以普通图片文件的形式放在 word/media 里,页眉、页脚和脚注各有自己的 XML 文件。

有两个限制。如果解压失败,说明 ZIP 本身不完整(常见于没下载完或没收全的附件),文字也跟着丢了;请重新获取文件,并和发件人核对文件大小。另外,已知行号和列号的坏标签,熟悉 XML 的人可以修好,再把各部件重新打包成 ZIP。这才是真正的修复,但不是人人都能做的活儿。

只要文字?在浏览器里取出来

本站的「DOCX 转文本」就是为“我只要文字”这种情况准备的。它在浏览器里一次读取一个 .docx,什么都不上传,手机浏览器也能用(大文件会慢一些)。选纯文本、Markdown 或 HTML,看一眼预览,然后复制或下载。以下是我们读代码、用测试文件跑出来的结果,看每种输出能保留什么:

文档里的内容纯文本MarkdownHTML
段落和标题保留,格式丢掉保留,带 # 标题、粗体、斜体和链接以标签形式保留
表格每个单元格占一行竖线分隔的表格真正的表格
图片丢掉以数据形式嵌入文件,可能让文件变得很大同样嵌入
脚注和尾注丢掉列在末尾列在末尾
页眉、页脚、批注丢掉丢掉丢掉
修订记录插入的保留,删除的丢掉同左同左

它不是修复工具。我们把损坏的测试文件交给它的解析器(mammoth 1.12.2)跑了一遍。截断了一部分的文件失败了,提示「文件被截断,或者格式与后缀不符。」像 Q&A 里那样标签不配对的文件也失败了:解析器遇到第一个 XML 错误就会停下。XML 本身合法、只是多了个它没预料到的元素的文件,文字全部取了出来。所以它适合文件完好、只是软件挑剔的情况,缺了字节时就帮不上忙。

它也读不了旧的 .doc 文件和加了密码的 .docx。我们用密码保存的一个 .docx 根本不是 ZIP,所以改名的办法也会失败。现在工具能认出这两种情况,会提示这是旧版 Word 格式(.doc)或加了密码的文档,并请你在 Word 或 Google 文档中打开,去掉密码,另存为 .docx。

从 .docx 里取出文字

什么办法都不管用时

有时候每条路都被堵死了。这是 2025 年 10 月发在 Microsoft Q&A 上的:

I have a submission in the next couple of minutes & my Microsoft Word file will not open now. It seemed to be working as expected earlier.

译文:“几分钟后我就要提交了,可我的 Microsoft Word 文件现在打不开了。之前明明一切正常。”出自提问“URGENT: Microsoft Word found unreadable content in (File Name).”。

Microsoft Q&A

一位 Microsoft 版主给出的正是本文说的这几条路:改名成 .zip 找 word/document.xml,试试 Google 文档或 LibreOffice,以安全模式启动 Word。提问者回复:“全都不管用。我刚和 Microsoft 客服通完电话,什么都不管用。”同月晚些时候,又有人说自己“超过 50 页”的硕士论文也出了同样的事,连第三方恢复工具都失败了。

字节缺了,哪个软件都补不回来。去找另一份副本:再问发件人要一次,翻翻已发送邮件、U 盘或云盘文件夹。发件人给的 PDF 在任何浏览器里都能打开;如果还需要当 Word 来编辑,本站的「PDF 转 Word」会把段落和表格重建成一个新的 .docx。前提是 PDF 里有真正的文字而不是扫描图,而且排版是重建的,不是照搬的。

把 PDF 转回 Word 文件

常见问题

这些办法对旧的 .doc 文件有用吗?
本站的提取工具没用,它只读 .docx。Google 文档能转换比 Office 95 新的 .doc 文件,Pages 文稿也能打开 .doc。
改完之后要以 .docx 发回去。
用能读写 DOCX 的 LibreOffice,或者能把副本存成 Word 格式的 Pages 文稿。本站的提取工具只给你文字。
改名成 .zip 后报错。
可能是没下载完整,可能文件加了密码(这时里面就不是 ZIP 了),也可能其实是一个旧的 .doc,只是名字叫 .docx。
手机上能做吗?
Pages 文稿能在 iPhone 和 iPad 上用。本站的提取工具在手机浏览器里能用,很大的文档要等一会儿。

更新于 2026年9月30日 · 截至 2026 年 9 月 30 日。核对依据为 LibreOffice 26.8、Mac 版 Pages 文稿 15.4(Apple 使用手册)、Windows 11 24H2 版本,以及「DOCX 转文本」工具内置的解析器 mammoth 1.12.2。