没有 Word 怎么打开 .docx,以及 Word 说文件损坏时怎么把文字取出来
两种情况:手里有个 .docx,却没有 Word;或者 Word 报出「Word found unreadable content」,拒绝打开。下面列出能免费打开它的软件、各自需要什么条件,以及哪个都打不开时,怎么把文字取出来。
不管是哪种情况,你眼下需要的往往是里面的文字,而不是排版。
这台电脑没有 Word:免费打开 .docx 的办法
可能是 Microsoft 365 订阅到期了,Word 只装在公司电脑上,你用的是 Mac 或手机,或者学校账号停用了。先确认一件事。Microsoft 的许可文档说,没有许可证的 Microsoft 365 应用仍然留在电脑上,进入“缩减功能模式”,在这种模式下“用户只能查看和打印其文档”。所以如果 Word 还在,双击文件也许仍能以只读方式打开。
也可能是文件搬到了一台从没装过 Word 的新电脑上。一位退休的 Mac 用户在 Apple Community 上写道:
When I retired, I put personal files on a flash drive. I can download the files, but the doc and docx files will not open. "Cannot open files at this time". I tried opening the files with the LibreOffice, did not work. …
译文:“退休的时候,我把个人文件存进了 U 盘。文件能拷出来,可 doc 和 docx 文件打不开,提示「Cannot open files at this time」(目前无法打开文件)。我试过用 LibreOffice 打开,也不行。……”2021 年 4 月,MacBook Pro,macOS 10.15。
通常第一个被推荐的 LibreOffice,在这里没帮上忙。另一条回复提到了 Pages 文稿:“Pages 能打开 Word 文档。”完整的选项如下:
| 办法 | 需要什么 | 值得知道的 |
|---|---|---|
| 网页版 Word | 一个免费的 Microsoft 账户和浏览器 | Microsoft 在网页上免费提供。用「上传文件」打开你的文件。免费账户有 5 GB OneDrive 空间。 |
| Google 文档 | 一个 Google 账号 | 上传到云端硬盘(「新建」>「上传文件」),然后双击。支持 .docx 和比 Office 95 新的 .doc,转换时上限 50 MB。 |
| LibreOffice 26.8 | 在 Windows、macOS 或 Linux 上安装 | 免费、开源,2026 年 8 月 26 日发布。能读写 DOCX,离线可用。 |
| Pages 文稿 | 一台 Mac、iPad 或 iPhone | 「文件」>「打开」。能打开 .doc 和 .docx。Apple 说 Pages 文稿继续免费;付费的 Creator Studio 会增加模板、素材和 AI 功能。 |
| 文本编辑 | 什么都不用,macOS 自带 | Apple 说它能打开其他文字处理软件(包括 Microsoft Word)创建的文稿。 |
| 本站的 DOCX 转文本 | 什么都不用 | 只能得到纯文本、Markdown 或 HTML。见下文。 |
在 Windows 上,你还会看到用写字板打开的老建议。这在更新到最新的电脑上行不通:从 Windows 11 24H2 版本起,Microsoft 已经在所有版本中移除了写字板。
如果是工作文件:网页版 Word 和 Google 文档会把文档放进个人云账户,你的单位或客户未必允许。LibreOffice、Pages 文稿和文本编辑则让文件留在你自己的电脑上。
「Word found unreadable content」:这些提示是什么意思
Word 拒绝一个文件时,通常会连着弹出几条提示。Microsoft Q&A 上一个有 300 多人标记为同样问题的帖子,记下了完整的顺序。以下是英文版的原文:
| Word 显示的内容 | 它说明了什么 |
|---|---|
| The file cannot be opened because there are problems with the contents. | Word 读不了文件的一部分。关掉之前,先点 Details(详细信息)。 |
| Word found unreadable content in "file name". Do you want to recover the contents of this document? If you trust the source of this document, click Yes. | Word 提出用它自己的方法修复。能不能成功,只有点 Yes 才知道。 |
| Microsoft Office cannot open this file because some parts are missing or invalid. | 修复没能越过损坏的地方。 |
Details 也要点开看看。在另一个帖子里,它显示的是「The name in the end tag element must match the element type in the start tag Location: Part:/word/document.xml, Line: 2, Column: 3479」。意思是存放正文的那部分,恰好在这个位置有一个坏掉的标签,这在下一节会派上用场。
如果你有 Word,Microsoft 关于损坏文档的文章还给了两个办法。「文件」>「打开」,单击一下这个文件,点「打开」按钮上的箭头,选 Open and Repair(打开并修复的那一项)。或者在这个对话框里把文件类型设为 Recover Text from Any File(*.*)(从任意文件恢复文本的那一项):格式、图形和域会丢失,但域里的文字、页眉、页脚、脚注和尾注会作为纯文本保留下来。
换一个软件,有时能读得更远,因为它用自己的方式解析文件。同一个帖子里 2010 年的一条回复:
Recently, in a class of 20 students, it has occurred 5 times for students when creating documents with a Table of Contents or Index. None of the fixes at the support link work. Only opening the file with Open Office allows recovery of some items.
译文:“最近在一个 20 人的班上,学生做带目录或索引的文档时,这种情况出现了 5 次。支持链接里的修复方法全都不管用。只有用 Open Office 打开文件,才能救回一部分内容。”出自帖子“File cannot be opened because there are problems with contents”中的回复,有 300 多人标记为同样的问题。
放到今天,这个角色就是从 OpenOffice 发展而来的 LibreOffice。要做好心理准备:救回的是“一部分内容”,而不是整个文件。
.docx 其实是个 ZIP:从 word/document.xml 里取文字
Microsoft 的 Open XML 文档里也这么写:把 .docx 改名成 .zip 就能看到里面的各个部件,其中 document.xml“包含文档正文的内容”。在那个结束标签损坏的帖子里(50 多人标记为同样的问题),一位志愿者回答说:
A Word 2007 docx file is nothing more than a zip package. If you change the extension from .docx to .zip, any zip archiver will be able to open it.
译文:“Word 2007 的 docx 文件不过是一个 ZIP 包。把扩展名从 .docx 改成 .zip,任何压缩软件都能打开它。”出自对提问“The office Open XML file cannot be opened because there are problems with the content”的回答,2010 年 7 月。
一定要在副本上做,千万别拿唯一的那份来试:
文字都放在 <w:t> 元素里,长文档读起来很费劲,但什么都没藏起来。在我们的测试文件里,图片以普通图片文件的形式放在 word/media 里,页眉、页脚和脚注各有自己的 XML 文件。
有两个限制。如果解压失败,说明 ZIP 本身不完整(常见于没下载完或没收全的附件),文字也跟着丢了;请重新获取文件,并和发件人核对文件大小。另外,已知行号和列号的坏标签,熟悉 XML 的人可以修好,再把各部件重新打包成 ZIP。这才是真正的修复,但不是人人都能做的活儿。
只要文字?在浏览器里取出来
本站的「DOCX 转文本」就是为“我只要文字”这种情况准备的。它在浏览器里一次读取一个 .docx,什么都不上传,手机浏览器也能用(大文件会慢一些)。选纯文本、Markdown 或 HTML,看一眼预览,然后复制或下载。以下是我们读代码、用测试文件跑出来的结果,看每种输出能保留什么:
| 文档里的内容 | 纯文本 | Markdown | HTML |
|---|---|---|---|
| 段落和标题 | 保留,格式丢掉 | 保留,带 # 标题、粗体、斜体和链接 | 以标签形式保留 |
| 表格 | 每个单元格占一行 | 竖线分隔的表格 | 真正的表格 |
| 图片 | 丢掉 | 以数据形式嵌入文件,可能让文件变得很大 | 同样嵌入 |
| 脚注和尾注 | 丢掉 | 列在末尾 | 列在末尾 |
| 页眉、页脚、批注 | 丢掉 | 丢掉 | 丢掉 |
| 修订记录 | 插入的保留,删除的丢掉 | 同左 | 同左 |
它不是修复工具。我们把损坏的测试文件交给它的解析器(mammoth 1.12.2)跑了一遍。截断了一部分的文件失败了,提示「文件被截断,或者格式与后缀不符。」像 Q&A 里那样标签不配对的文件也失败了:解析器遇到第一个 XML 错误就会停下。XML 本身合法、只是多了个它没预料到的元素的文件,文字全部取了出来。所以它适合文件完好、只是软件挑剔的情况,缺了字节时就帮不上忙。
它也读不了旧的 .doc 文件和加了密码的 .docx。我们用密码保存的一个 .docx 根本不是 ZIP,所以改名的办法也会失败。现在工具能认出这两种情况,会提示这是旧版 Word 格式(.doc)或加了密码的文档,并请你在 Word 或 Google 文档中打开,去掉密码,另存为 .docx。
什么办法都不管用时
有时候每条路都被堵死了。这是 2025 年 10 月发在 Microsoft Q&A 上的:
I have a submission in the next couple of minutes & my Microsoft Word file will not open now. It seemed to be working as expected earlier.
译文:“几分钟后我就要提交了,可我的 Microsoft Word 文件现在打不开了。之前明明一切正常。”出自提问“URGENT: Microsoft Word found unreadable content in (File Name).”。
一位 Microsoft 版主给出的正是本文说的这几条路:改名成 .zip 找 word/document.xml,试试 Google 文档或 LibreOffice,以安全模式启动 Word。提问者回复:“全都不管用。我刚和 Microsoft 客服通完电话,什么都不管用。”同月晚些时候,又有人说自己“超过 50 页”的硕士论文也出了同样的事,连第三方恢复工具都失败了。
字节缺了,哪个软件都补不回来。去找另一份副本:再问发件人要一次,翻翻已发送邮件、U 盘或云盘文件夹。发件人给的 PDF 在任何浏览器里都能打开;如果还需要当 Word 来编辑,本站的「PDF 转 Word」会把段落和表格重建成一个新的 .docx。前提是 PDF 里有真正的文字而不是扫描图,而且排版是重建的,不是照搬的。
常见问题
- 这些办法对旧的 .doc 文件有用吗?
- 本站的提取工具没用,它只读 .docx。Google 文档能转换比 Office 95 新的 .doc 文件,Pages 文稿也能打开 .doc。
- 改完之后要以 .docx 发回去。
- 用能读写 DOCX 的 LibreOffice,或者能把副本存成 Word 格式的 Pages 文稿。本站的提取工具只给你文字。
- 改名成 .zip 后报错。
- 可能是没下载完整,可能文件加了密码(这时里面就不是 ZIP 了),也可能其实是一个旧的 .doc,只是名字叫 .docx。
- 手机上能做吗?
- Pages 文稿能在 iPhone 和 iPad 上用。本站的提取工具在手机浏览器里能用,很大的文档要等一会儿。
更新于 2026年9月30日 · 截至 2026 年 9 月 30 日。核对依据为 LibreOffice 26.8、Mac 版 Pages 文稿 15.4(Apple 使用手册)、Windows 11 24H2 版本,以及「DOCX 转文本」工具内置的解析器 mammoth 1.12.2。