Word なしで .docx を開く方法と、Word に破損と言われたときに文字を取り出す方法

状況は2つ。.docx はあるのに Word がない。あるいは Word が「Word found unreadable content」と言ってファイルを開かない。無料で開けるソフトと、それぞれが求めるもの、そしてどれでも開かないファイルから文字を取り出す方法を並べる。

Ashton
ファイル形式

どちらの場合も、今すぐ必要なのはたいていレイアウトではなく、書かれている文字だ。

このパソコンに Word がない:.docx を無料で開く方法

Microsoft 365 のサブスクリプションが切れた、Word は職場のパソコンにしかない、Mac やスマホを使っている、学校のアカウントが終わった。まず1つ確かめてほしい。Microsoft のライセンスについての文書によると、ライセンスのない Microsoft 365 Apps はインストールされたまま「機能制限モード」になり、そこでは「ユーザーはドキュメントの表示と印刷のみ」ができる。つまり Word が残っているなら、ファイルをダブルクリックすれば、読むだけならまだ開けるかもしれない。

あるいは、Word が入ったことのない新しいパソコンにファイルを移す場合もある。退職した Mac ユーザーが Apple Community に書いた例だ。

When I retired, I put personal files on a flash drive. I can download the files, but the doc and docx files will not open. "Cannot open files at this time". I tried opening the files with the LibreOffice, did not work. …

訳:「退職するときに、個人のファイルを USB メモリに入れた。ファイルは取り込めるのだが、doc と docx のファイルが開かない。“Cannot open files at this time”(今はファイルを開けません)と出る。LibreOffice で開こうとしたが、だめだった。……」。2021年4月、macOS 10.15 の MacBook Pro。

Apple Community

よく最初に勧められる LibreOffice も、ここでは役に立たなかった。別の返信は Pages を挙げた。「Pages なら Word の書類を開ける」。一覧にするとこうなる。

方法必要なもの知っておくこと
Web 版 Word無料の Microsoft アカウントとブラウザMicrosoft が Web で無料で提供している。「ファイルをアップロードする」でファイルを開く。無料アカウントには OneDrive が5GB 付く。
Google ドキュメントGoogle アカウントドライブにアップロードして(「新規」>「ファイルのアップロード」)、ダブルクリックする。.docx と、Office 95 より新しい .doc を受け付け、変換するときは50MB まで。
LibreOffice 26.8Windows、macOS、Linux へのインストール無料のオープンソース。2026年8月26日リリース。DOCX を読み書きでき、オフラインで使える。
PagesMac、iPad、iPhone「ファイル」>「開く」。.doc と .docx を開ける。Apple によると Pages は無料のままで、有料の Creator Studio ではテンプレート、素材、AI の機能が加わる。
テキストエディット何も要らない。macOS に入っているApple によると、Microsoft Word などほかのワープロで作った書類を開ける。
このサイトの DOCX → テキスト何も要らないテキスト、Markdown、HTML のみ。後で説明する。

Windows では今でも、ワードパッドで開けという古い助言が見つかる。最新の状態のパソコンではうまくいかない。Microsoft は Windows 11 バージョン 24H2 から、すべてのエディションでワードパッドを削除した。

仕事のファイルなら注意がいる。Web 版 Word と Google ドキュメントは、書類を個人のクラウドアカウントに置くことになり、勤め先や取引先がそれを認めないこともある。LibreOffice、Pages、テキストエディットなら、ファイルは自分のパソコンに残る。

「Word found unreadable content」:メッセージの意味

Word はたいてい、いくつものメッセージを続けて出してファイルを拒む。300人以上が同じ質問だと印を付けた Microsoft Q&A のスレッドに、その順番が記録されている。以下は英語版の表示だ。

Word の表示分かること
The file cannot be opened because there are problems with the contents.Word がファイルの一部を読めなかった。閉じる前に Details(詳細)をクリックする。
Word found unreadable content in "file name". Do you want to recover the contents of this document? If you trust the source of this document, click Yes.Word が自前の修復を申し出ている。うまくいくかどうかは、Yes を押してみるしかない。
Microsoft Office cannot open this file because some parts are missing or invalid.修復が、傷んだ部分を越えられなかった。

Details もクリックしておく。別のスレッドでは「The name in the end tag element must match the element type in the start tag Location: Part:/word/document.xml, Line: 2, Column: 3479」と表示された。本文を入れている部分の、ちょうどその位置でタグが壊れているということで、次の節で意味を持ってくる。

Word があるなら、破損した文書についての Microsoft の記事が、さらに2つの方法を挙げている。「ファイル」>「開く」でファイルを1回クリックし、「開く」ボタンの矢印から Open and Repair(開いて修復する項目)を選ぶ。または、そのダイアログのファイルの種類を Recover Text from Any File(*.*)(どのファイルからもテキストを回復する項目)にする。書式、図、フィールドは失われるが、フィールドの文字、ヘッダー、フッター、脚注、文末脚注はただのテキストとして残る。

別のソフトのほうが先まで読めることもある。ファイルを自分なりのやり方で読むからだ。同じスレッドの、2010年の返信。

Recently, in a class of 20 students, it has occurred 5 times for students when creating documents with a Table of Contents or Index. None of the fixes at the support link work. Only opening the file with Open Office allows recovery of some items.

訳:「最近、20人のクラスで、目次や索引の入った文書を作っていた学生に5回起きた。サポートのリンクにある対処法はどれも効かない。Open Office でファイルを開いたときだけ、一部を取り戻せる」。スレッド「File cannot be opened because there are problems with contents」への返信。300人以上が同じ質問だと印を付けている。

Microsoft Q&A

今なら、OpenOffice から生まれた LibreOffice がそれにあたる。取り戻せるのは「一部」であって、ファイル全体ではないと考えておく。

.docx の中身は ZIP:word/document.xml から文字を取り出す

Microsoft の Open XML のドキュメントにもそう書いてある。.docx を .zip に名前を変えれば中の部品が見え、document.xml が「文書の本文の内容を含む」。終了タグが壊れた例のスレッド(50人以上が同じ質問)で、ボランティアの回答者はこう書いた。

A Word 2007 docx file is nothing more than a zip package. If you change the extension from .docx to .zip, any zip archiver will be able to open it.

訳:「Word 2007 の docx ファイルは ZIP パッケージにすぎない。拡張子を .docx から .zip に変えれば、どの圧縮ソフトでも開ける」。質問「The office Open XML file cannot be opened because there are problems with the content」への回答、2010年7月。

Microsoft Q&A

必ずコピーでやる。手元にそれしかないファイルでは、絶対にやらない。

.docx をコピーする
コピーの名前を .zip にする
展開する
word/document.xml をテキストエディタで開く
<w:t> と </w:t> の間を読む
名前の末尾に「.docx」が見えないなら、拡張子が隠れている。エクスプローラーで表示をオンにする。

文字は <w:t> 要素の中にあるので、長い文書だと読むのに骨が折れるが、何も隠れてはいない。私たちが試したファイルでは、画像は word/media に普通の画像ファイルとして入っていて、ヘッダー、フッター、脚注はそれぞれ別の XML ファイルになっていた。

限界が2つある。展開に失敗するなら ZIP が欠けていて(添付やダウンロードが最後まで終わっていないことが多い)、文字も一緒に失われている。ファイルをもう一度もらい、送り主と容量を比べる。それから、何行目の何文字目と分かっている壊れたタグは、XML に慣れた人なら直して、部品を ZIP に戻せる。それが本当の修復だが、誰にでもできる作業ではない。

文字だけでいいなら、ブラウザで取り出す

このサイトの DOCX → テキストは、「文字さえあればいい」場合のためのものだ。.docx を一度に1つ、ブラウザの中で読むので、何もアップロードされない。スマホのブラウザでも動く(大きなファイルは遅くなる)。テキスト、Markdown、HTML から選び、プレビューを確かめて、コピーするかダウンロードする。コードを読み、テストファイルを通して確かめた、形式ごとに残るものは次のとおりだ。

文書の中身テキストMarkdownHTML
段落と見出し残る。書式は落ちる残る。# の見出し、太字、斜体、リンク付きタグとして残る
表セルごとに1行パイプで区切った表本物の表
画像落ちるデータとしてファイルに埋め込まれる。ファイルが大きくなることがある同じように埋め込まれる
脚注と文末脚注落ちる末尾に一覧で出る末尾に一覧で出る
ヘッダー、フッター、コメント落ちる落ちる落ちる
変更履歴挿入は残り、削除は落ちる同じ同じ

修復ツールではない。壊れたテストファイルを解析器(mammoth 1.12.2)に通してみた。途中で切れたファイルは「ファイルが途中で切れているか、形式が拡張子と合っていません。」で失敗した。Q&A の例のようにタグの対応が崩れたファイルも失敗した。解析器は最初の XML エラーで止まる。XML としては正しく、想定外の要素が入っていたファイルからは、文字がすべて取り出せた。つまり、ファイルは無事でソフトが気難しいだけのときには役に立つが、バイトが欠けているときは役に立たない。

古い .doc ファイルやパスワード付きの .docx も読めない。パスワードを付けて保存した .docx は ZIP ではなかったので、名前を変える方法も失敗する。このツールは今はどちらの場合も見分けて、古い Word 形式(.doc)かパスワード付きの文書だと表示し、Word や Google ドキュメントで開いてパスワードを外し、.docx で保存し直すよう案内する。

.docx から文字を取り出す

どれもうまくいかないとき

すべての道がふさがることもある。2025年10月に Microsoft Q&A に投稿されたものだ。

I have a submission in the next couple of minutes & my Microsoft Word file will not open now. It seemed to be working as expected earlier.

訳:「あと数分で提出なのに、Microsoft Word のファイルが今になって開かない。さっきまでは普通に動いていたのに」。質問「URGENT: Microsoft Word found unreadable content in (File Name).」より。

Microsoft Q&A

Microsoft のモデレーターは、この記事と同じ道を勧めた。.zip に名前を変えて word/document.xml を探す、Google ドキュメントか LibreOffice を試す、Word をセーフモードで起動する。質問者の返事は「どれもうまくいかない。Microsoft のサポートとの電話を終えたところだけど、何も効かない」。その月の終わりには別の人が、自分の「50ページを超える」修士論文も同じことになり、他社の修復ツールもだめだったと書き込んだ。

バイトが欠けているなら、どんなソフトも元に戻せない。別のコピーを探す。送り主にもう一度頼む、送信済みのメール、USB メモリ、クラウドのフォルダを確かめる。送り主が PDF をくれればどのブラウザでも開けるし、もう一度 Word で編集する必要があるなら、このサイトの PDF を Word に で段落と表を組み立て直し、新しい .docx を作れる。スキャンではなく本物の文字が入った PDF が必要で、レイアウトはコピーではなく組み立て直しになる。

PDF を Word ファイルに戻す

よくある質問

古い .doc ファイルでも使えますか?
このサイトの抽出ツールは .docx しか読まないので使えない。Google ドキュメントは Office 95 より新しい .doc を変換でき、Pages も .doc を開ける。
編集して .docx で送り返さなければなりません。
DOCX を読み書きできる LibreOffice か、Word 形式でコピーを保存できる Pages を使う。このサイトの抽出ツールで得られるのは文字だけだ。
.zip に名前を変えるとエラーになります。
ダウンロードが最後まで終わっていないか、パスワード付き(そうなると中身は ZIP ではない)か、名前だけが .docx の古い .doc かもしれない。
スマホでもできますか?
Pages は iPhone と iPad で動く。このサイトの抽出ツールはスマホのブラウザで動くが、とても大きな文書は時間がかかる。

最終更新 2026年9月30日 · 2026年9月30日時点。LibreOffice 26.8、Mac 用 Pages 15.4(Apple のユーザガイド)、Windows 11 バージョン 24H2、DOCX → テキストに入っている解析器 mammoth 1.12.2 で確かめた。