چطور فایل docx را بدون ورد باز کنیم، و وقتی ورد میگوید فایل خراب است متنش را بیرون بکشیم
دو وضعیت: یک فایل docx دارید و ورد ندارید، یا ورد فایل را با پیام "Word found unreadable content" (ورد محتوای ناخوانا پیدا کرد) رد میکند. در ادامه برنامههای رایگانی که بازش میکنند، اینکه هر کدام از شما چه میخواهد، و راه بیرون کشیدن متن از فایلی که هیچکدام بازش نمیکنند آمده است.
در هر دو حالت، چیزی که همین حالا لازم دارید معمولاً کلمههاست، نه صفحهآرایی.
ورد روی این کامپیوتر نیست: راههای رایگان باز کردن docx
شاید اشتراک Microsoft 365 تمام شده، ورد فقط روی کامپیوتر محل کار است، با مک یا گوشی کار میکنید، یا حساب دانشگاهیتان بسته شده است. اول یک چیز را بررسی کنید. مستندات مجوز مایکروسافت میگوید برنامههای Microsoft 365 بدون مجوز نصبشده میمانند و به حالتی به نام reduced functionality mode (حالت کارکرد محدود) میروند که در آن "کاربران فقط میتوانند سندهایشان را ببینند و چاپ کنند." پس اگر ورد هنوز روی دستگاه هست، شاید با دوبار کلیک فایل برای خواندن باز شود.
یا فایلها به کامپیوتر تازهای میروند که هیچوقت ورد نداشته است. کاربر مکی در Apple Community، بعد از بازنشستگی:
When I retired, I put personal files on a flash drive. I can download the files, but the doc and docx files will not open. "Cannot open files at this time". I tried opening the files with the LibreOffice, did not work. …
ترجمه: "وقتی بازنشسته شدم، فایلهای شخصیام را روی فلش ریختم. میتوانم فایلها را دانلود کنم، اما فایلهای doc و docx باز نمیشوند. پیام 'Cannot open files at this time' (فعلاً نمیشود فایلها را باز کرد) میآید. باز کردن فایلها با LibreOffice را امتحان کردم، نشد. …" آوریل ۲۰۲۱، مکبوک پرو با macOS 10.15.
برنامهی LibreOffice، که معمولاً اولین پیشنهاد است، اینجا کمکی نکرد. پاسخ دیگری به Pages اشاره کرد: "برنامهی Pages میتواند سندهای ورد را باز کند." فهرست کامل این است:
| گزینه | از شما چه میخواهد | چه چیزی را بدانید |
|---|---|---|
| نسخهی وب Word | یک حساب رایگان مایکروسافت و مرورگر | رایگان روی وب از طرف مایکروسافت. فایلتان را با "Upload a file" (آپلود فایل) باز کنید. حسابهای رایگان ۵ گیگابایت فضای OneDrive دارند. |
| سرویس Google Docs | یک حساب گوگل | فایل را در Drive آپلود کنید (New > File upload، یعنی جدید > آپلود فایل)، بعد رویش دوبار کلیک کنید. فایل docx و فایل doc جدیدتر از Office 95 را میپذیرد، تا ۵۰ مگابایت هنگام تبدیل. |
| برنامهی LibreOffice 26.8 | نصب روی ویندوز، macOS یا لینوکس | رایگان و متنباز، منتشرشده در ۲۶ اوت ۲۰۲۶. فایل DOCX را بدون اینترنت میخواند و مینویسد. |
| برنامهی Pages | مک، آیپد یا آیفون | از File > Open. فایل doc و docx را باز میکند. اپل میگوید Pages رایگان میماند؛ اشتراک پولی Creator Studio قالب، رسانه و قابلیتهای هوش مصنوعی اضافه میکند. |
| برنامهی TextEdit | هیچ، همراه macOS میآید | اپل میگوید سندهای برنامههای واژهپرداز دیگر، از جمله Microsoft Word، را باز میکند. |
| ابزار DOCX به متن همین سایت | هیچ | فقط متن، Markdown یا HTML. پایینتر را ببینید. |
در ویندوز هنوز توصیههای قدیمی برای باز کردن فایل در WordPad پیدا میکنید. این روی کامپیوتر بهروز جواب نمیدهد: مایکروسافت WordPad را از همهی ویرایشها، از ویندوز ۱۱ نسخهی 24H2 به بعد، حذف کرده است.
برای فایلهای کاری: نسخهی وب Word و Google Docs سند را در یک حساب ابری شخصی میگذارند، که شاید کارفرما یا مشتریتان اجازه ندهد. برنامههای LibreOffice، Pages و TextEdit آن را روی کامپیوتر خودتان نگه میدارند.
پیام "Word found unreadable content": پیامها چه معنایی دارند
ورد معمولاً فایل را با زنجیرهای از پیامها رد میکند. رشتهای در Microsoft Q&A که بیش از ۳۰۰ نفر آن را پرسش خودشان هم علامت زدهاند، این ترتیب را ثبت کرده است (با متن انگلیسی پیامهای ورد):
| آنچه ورد میگوید | معنایش برای شما |
|---|---|
| The file cannot be opened because there are problems with the contents. | ورد نتوانست بخشی از فایل را بخواند. پیش از بستن پیام، روی Details (جزئیات) کلیک کنید. |
| Word found unreadable content in "file name". Do you want to recover the contents of this document? If you trust the source of this document, click Yes. | ورد تعمیر خودش را پیشنهاد میدهد. زدن Yes تنها راه فهمیدن این است که جواب میدهد یا نه. |
| Microsoft Office cannot open this file because some parts are missing or invalid. | تعمیر از جای خرابی رد نشد. |
روی Details هم کلیک کنید. در رشتهی دیگری این پیام را نشان داد: "The name in the end tag element must match the element type in the start tag Location: Part:/word/document.xml, Line: 2, Column: 3479". بخشی که متن را نگه میدارد درست در همان نقطه یک برچسب شکسته دارد، و این در بخش بعدی مهم است.
اگر ورد دارید، مقالهی مایکروسافت دربارهی سندهای آسیبدیده دو کار دیگر پیشنهاد میکند. از File > Open، یک بار روی فایل کلیک کنید، روی فلش کنار دکمهی Open بزنید و Open and Repair (باز کردن و تعمیر) را انتخاب کنید. یا در همان پنجره، نوع فایل را روی Recover Text from Any File(*.*) (بازیابی متن از هر فایلی) بگذارید: قالببندی، گرافیک و فیلدها از دست میروند، اما متن فیلدها، سرصفحهها، پاصفحهها، پانویسها و پینوشتها به شکل متن ساده میمانند.
گاهی برنامهی دیگری جلوتر میرود، چون فایل را به روش خودش میخواند. پاسخی در همان رشته، از سال ۲۰۱۰:
Recently, in a class of 20 students, it has occurred 5 times for students when creating documents with a Table of Contents or Index. None of the fixes at the support link work. Only opening the file with Open Office allows recovery of some items.
ترجمه: "اخیراً در کلاسی ۲۰ نفره، ۵ بار برای دانشجوهایی پیش آمده که سندی با فهرست مطالب یا نمایه میساختند. هیچکدام از راهحلهای پیوند پشتیبانی جواب نمیدهد. فقط باز کردن فایل با Open Office امکان بازیابی بعضی بخشها را میدهد." پاسخی در رشتهی "File cannot be opened because there are problems with contents"، با بیش از ۳۰۰ نفر که همین پرسش را دارند.
امروز این برنامه LibreOffice است که از دل OpenOffice بیرون آمد. انتظار "بعضی بخشها" را داشته باشید، نه کل فایل.
فایل docx در واقع zip است: بیرون کشیدن متن از word/document.xml
مستندات Open XML مایکروسافت هم همین را میگوید: پسوند docx را به zip تغییر دهید تا بخشهایش را ببینید، و فایل document.xml "محتوای بدنهی اصلی سند را در خود دارد." در رشتهی برچسب پایانی شکسته (بیش از ۵۰ نفر با همین پرسش)، یک داوطلب جواب داد:
A Word 2007 docx file is nothing more than a zip package. If you change the extension from .docx to .zip, any zip archiver will be able to open it.
ترجمه: "فایل docx ورد ۲۰۰۷ چیزی جز یک بستهی zip نیست. اگر پسوند را از docx به zip تغییر دهید، هر برنامهی فشردهسازیای میتواند بازش کند." پاسخ به پرسش "The office Open XML file cannot be opened because there are problems with the content"، ژوئیهی ۲۰۱۰.
روی یک کپی کار کنید، هرگز روی تنها نسخهتان:
متن درون عنصرهای <w:t> است، پس خواندن یک سند بلند کند پیش میرود، اما چیزی پنهان نیست. در فایلهای آزمایشی ما، عکسها در پوشهی word/media به شکل فایلهای تصویری معمولی بودند و سرصفحهها، پاصفحهها و پانویسها فایلهای XML جداگانهی خودشان را داشتند.
دو محدودیت هست. اگر خارج کردن از حالت فشرده شکست بخورد، فایل zip ناقص است (اغلب پیوست یا دانلودی که تمام نشده) و متن هم همراهش رفته؛ فایل را دوباره بگیرید و حجمش را با فرستنده مقایسه کنید. و برچسب شکسته در سطر و ستون مشخص را کسی که با XML راحت است میتواند درست کند و بعد بخشها را دوباره zip کند. تعمیر واقعی همین است، و کار هر کسی نیست.
فقط متن را لازم دارید؟ در مرورگر بیرونش بکشید
ابزار "DOCX به متن" این سایت برای حالت "فقط کلمهها را لازم دارم" است. هر بار یک فایل docx را داخل مرورگر شما میخواند، پس چیزی آپلود نمیشود، و در مرورگر گوشی هم کار میکند (فایلهای بزرگ کندترند). متن ساده، Markdown یا HTML را انتخاب کنید، پیشنمایش را ببینید، بعد کپی یا دانلود کنید. آنچه هر خروجی نگه میدارد، بر اساس خواندن کدش و آزمودن فایلهای نمونه:
| در سند | متن ساده | Markdown | HTML |
|---|---|---|---|
| بندها و عنوانها | میمانند، قالببندی حذف میشود | میمانند، با عنوانهای #، پررنگ، کج و پیوندها | به شکل برچسب میمانند |
| جدولها | هر خانه در یک خط جدا | جدول با خط عمودی (pipe table) | جدول واقعی |
| تصویرها | حذف میشوند | به شکل داده درون فایل جاسازی میشوند، که میتواند حجیمش کند | به همان شکل جاسازی میشوند |
| پانویسها و پینوشتها | حذف میشوند | در انتها فهرست میشوند | در انتها فهرست میشوند |
| سرصفحه، پاصفحه، یادداشتها | حذف میشوند | حذف میشوند | حذف میشوند |
| تغییرات ردیابیشده | افزودهها میمانند، حذفشدهها نه | همینطور | همینطور |
ابزار تعمیر نیست. فایلهای آزمایشی خراب را از تجزیهگر آن (mammoth 1.12.2) رد کردیم. فایلی که از وسط بریده شده بود با پیام "فایل ناقص است، یا قالبش با پسوند نمیخواند." شکست خورد. فایلی با برچسب نامتوازن، مثل مورد Q&A، هم شکست خورد: تجزیهگر در اولین خطای XML میایستد. فایلی با XML درست و عنصری که انتظارش را نداشت، همهی متنش را داد. پس وقتی به کار میآید که فایل سالم است و برنامهای سختگیری میکند، نه وقتی بایتهایی گم شدهاند.
فایلهای قدیمی doc و فایلهای docx رمزدار را هم نمیتواند بخواند. یک docx که با رمز ذخیره کردیم اصلاً zip نبود، پس تغییر نام هم شکست میخورد. حالا ابزار هر دو حالت را تشخیص میدهد: میگوید این یک فایل قدیمی ورد (doc) یا سندِ رمزدار است و از شما میخواهد آن را در ورد یا Google Docs باز کنید، رمز را بردارید و با پسوند docx ذخیره کنید.
وقتی هیچچیز جواب نمیدهد
گاهی همهی راهها بسته است. این در اکتبر ۲۰۲۵ در Microsoft Q&A منتشر شد:
I have a submission in the next couple of minutes & my Microsoft Word file will not open now. It seemed to be working as expected earlier.
ترجمه: "چند دقیقهی دیگر باید کارم را تحویل بدهم و فایل ورد الان باز نمیشود. قبلاً ظاهراً درست کار میکرد." از پرسش "URGENT: Microsoft Word found unreadable content in (File Name)."
یک ناظر مایکروسافت همین راههای این نوشته را پیشنهاد داد: تغییر پسوند به zip و پیدا کردن word/document.xml، امتحان Google Docs یا LibreOffice، اجرای ورد در حالت امن. پرسنده جواب داد: "هیچکدام جواب نمیدهد. همین الان تماسم با پشتیبانی مایکروسافت تمام شد. هیچچیز جواب نمیدهد." بعدتر در همان ماه، کس دیگری نوشت پایاننامهی کارشناسی ارشدش، "بیش از ۵۰ صفحه"، به همین روز افتاده و یک ابزار بازیابی شخص ثالث هم شکست خورده است.
وقتی بایتهایی گم شدهاند، هیچ برنامهای نمیتواند برشان گرداند. دنبال نسخهی دیگری بگردید: دوباره از فرستنده بخواهید، نامههای ارسالشده، فلش یا پوشهی ابری را نگاه کنید. یک PDF از فرستنده در هر مرورگری باز میشود، و اگر دوباره لازم است مثل فایل ورد ویرایشش کنید، ابزار "PDF به Word" همین سایت بندها و جدولهایش را در یک docx تازه بازسازی میکند. به PDFی با متن واقعی نیاز دارد، نه اسکن، و صفحهآرایی بازسازی میشود، نه کپی.
پرسشهای پرتکرار
- اینها برای فایلهای قدیمی doc هم جواب میدهد؟
- ابزار استخراج این سایت نه، چون فقط docx میخواند. سرویس Google Docs فایلهای doc جدیدتر از Office 95 را تبدیل میکند و Pages هم doc را باز میکند.
- بعد از ویرایش باید دوباره به شکل docx بفرستمش.
- از LibreOffice استفاده کنید که DOCX را میخواند و مینویسد، یا از Pages که میتواند یک کپی با قالب ورد ذخیره کند. ابزار استخراج اینجا فقط متن میدهد.
- تغییر پسوند به zip خطا میدهد.
- شاید دانلود ناقص است، شاید فایل رمز دارد (که در این صورت درونش zip نیست)، یا شاید یک doc قدیمی است که فقط اسمش docx است.
- روی گوشی هم میشود؟
- برنامهی Pages روی آیفون و آیپد اجرا میشود. ابزار استخراج اینجا در مرورگر گوشی کار میکند؛ سندهای خیلی بزرگ کمی طول میکشند.
بهروزرسانی ۸ مهر ۱۴۰۵ · اطلاعات تا ۳۰ سپتامبر ۲۰۲۶. با LibreOffice 26.8، Pages 15.4 برای مک (راهنمای کاربر اپل)، ویندوز ۱۱ نسخهی 24H2 و mammoth 1.12.2، تجزیهگر درون ابزار DOCX به متن، مقایسه شد.