وقتی PDF به فایل Word تبدیل میشود چه چیزی باقی میماند
یک PDF را به Word تبدیل میکنید و جدول کج درمیآید. گمان میکنید مبدل بد است، یکی دیگر را امتحان میکنید و تقریباً همان نتیجه را میگیرید. بعضی مشکلها با عوض کردن ابزار برطرف نمیشوند.
یک PDF رها کنید تا متن درونش در قالب بند و جدول در یک فایل Word بازسازی شود. هیچچیز به شکل تصویر صفحه چسبانده نمیشود، پس آنچه میگیرید سندی است که بیدرنگ میتوانید در آن کار کنید.
بدون آپلود
PDF برای تبدیل
PDF باید متن واقعی داشته باشد. PDF اسکنشده تصویر صفحه است، پس متنی برای بیرون کشیدن ندارد. فایلها فقط داخل همین مرورگر باز میشوند و هرگز آپلود نمیشوند.
ترتیب خواندن، بندها و جدولها منتقل میشوند، اما جای دقیق روی صفحه نه. PDF هیچوقت ثبت نمیکند چه چیزی بند بوده و چه چیزی جدول، پس هر دو از روی جای نویسهها بازسازی میشوند.
تصویرها، مهرها و امضاهای چاپشده روی صفحه هم بیرون کشیده و در سند گذاشته میشوند؛ به ترتیب خواندن، نه در مختصات اصلی.
PDF اسکنشده به جای متن عکس دارد، پس چیزی برای تبدیل نیست. فایل را بگذارید، ابزار بلافاصله خبر میدهد.
صفحهها بهصورت تصویر کامل چسبانده نمیشوند. فایلی که دانلود میکنید در Word یا Excel بهصورت سند قابل ویرایش باز میشود.
فایل باید متن واقعی داشته باشد. چند فایل با هم هم اشکالی ندارد.
هر صفحه خوانده میشود تا جای نویسههایش معلوم شود و آنها در بند و جدول گروهبندی شوند. پیشرفت با شماره صفحه نشان داده میشود.
در Word آماده ویرایش باز میشود. PDF اصلی شما دستنخورده میماند.
PDF قالبی برای نگهداشتن متن نیست، بلکه برای کشیدن صفحه است. آنچه درون فایل است فهرست بلندی از دستورهاست که میگوید این نویسه را اینجا چاپ کن، و هیچجا ثبت نشده که بند کجا تمام میشد یا کدام دسته عدد زمانی جدول بود. آن اطلاعات درست همان لحظهای دور ریخته میشود که سند به PDF صادر میشود.
پس این بازسازی است نه تبدیل. جای نشستن نویسهها، فاصله سطرها و اندازه قلم وارونه خوانده میشود تا شکل اصلی حدس زده شود. فاصلهای بیش از معمول، یا سطری که خیلی پیش از حاشیه به پایان رسیده، یعنی بندی همانجا تمام شده است. خانههایی که لبهشان در چند سطر پیاپی در یک جا ایستادهاند یعنی جدول.
چون حدس است ممکن است خطا کند. کاری که نمیکند این است که مقداری را که نیافته از خود نسازد. صفحههای بدون متن خالی گزارش میشوند و سند آمادهشده پیش از رسیدن به دست شما دوباره خوانده و بررسی میشود.
ترتیب خواندن، بندها، عنوانها و جدولها میآیند، شکست صفحه هم همینطور. تصویرها و مهرها و امضاهای روی صفحه هم بیرون کشیده و گذاشته میشوند، فقط جایشان به ترتیب خواندن است نه مختصات اصلی. آنچه نمیآید جای دقیق روی صفحه و قلمها و رنگ نوشته است.
صفحهآرایی عمداً تقلید نمیشود. بازتولید موقعیتها یعنی پاشیدن کادرهای متنی روی مختصات ثابت، و سندی که اینگونه ساخته شود باز میشود اما بهمحض ویرایش یک سطر فرو میریزد. هدف این ابزار سندی است که بتوانید در آن کار کنید.
| مورد | میآید؟ |
|---|---|
| ترتیب خواندن و واژهها | بله |
| جدا شدن بندها | از روی موقعیت بازسازی میشود |
| عنوانها | قلم بزرگتر از متن اصلی عنوان شمرده میشود |
| جدولها | از مقادیر همتراز بازسازی میشوند |
| شکست صفحه | بله |
| قلمها، رنگ، صفحهآرایی دقیق | خیر |
| تصویرها، مهرها، امضاها | بله، به ترتیب خواندن قرار میگیرند |
PDFای که با عکس گرفتن از کاغذ یا عبور دادن آن از اسکنر اداری ساخته شده، برای هر صفحه یک تصویر است. چشم شما حرف میبیند اما فایل حتی یک حرف ندارد. چیزی برای بیرون کشیدن نیست، پس چیزی هم برای بازسازی نیست.
ابزار این را رک میگوید، نه اینکه فایلی خالی دستتان بدهد. اگر تنها بخشی از صفحهها اسکن باشد، شماره صفحههایی را که خالی برگشتهاند نام میبرد. خواندن متن از درون تصویر کاری نیست که این ابزار انجام دهد.
همه تبدیل درون همین مرورگر انجام میشود. خواندن PDF و نوشتن سند تازه هر دو کار کدی است که روی دستگاه شما اجرا میشود. اصلاً گامی به نام بارگذاری وجود ندارد.
میتوانید خودتان بررسی کنید. زبانه شبکه را در ابزار توسعهدهنده (F12) باز کنید و یک تبدیل را اجرا کنید: درخواستی به اندازه فایل شما یا ظاهر میشود یا نمیشود.
خیر. خواندن PDF و نوشتن فایل Word هر دو درون همین مرورگر انجام میشود. نه حسابی لازم است نه چیزی برای نصب.
خیر. واژهها، ترتیب خواندن، بندها و جدولها میآیند، اما جای قرار گرفتن روی صفحه بازتولید نمیشود. تقلید آن یعنی میخ کردن کادرهای متنی به مختصات، و چنین سندی ویرایشپذیر نیست.
جدولهای داخل PDF اغلب خط ندارند و آنجا که دارند، آن خطها روی لایهای دیگر کشیده شدهاند که بیرون کشیدن متن هرگز نمیبیندشان. بنابراین جدول با بررسی اینکه خانهها رو به پایین همتراز میمانند یا نه پیدا میشود. فاصله ستونهای بسیار تنگ و خانههای ادغامشده میتوانند این را بههم بریزند.
خیر. اسکن تصویر صفحه است و حتی یک حرف در آن نیست. یکی را رها کنید، ابزار بیدرنگ میگوید.
اگر گذرواژه را بدانید کار میکند. وقتی ابزار به فایل رمزگذاریشده بربخورد، کادر گذرواژه ظاهر میشود. آن را بنویسید و دوباره تبدیل را اجرا کنید.
محدودیتی گذاشته نشده. اما همهچیز روی دستگاه شما اجرا میشود، پس سند خیلی بلند به همان نسبت بیشتر طول میکشد. رایانه سریعتر از تلفن از پس آن برمیآید.
یک PDF را به Word تبدیل میکنید و جدول کج درمیآید. گمان میکنید مبدل بد است، یکی دیگر را امتحان میکنید و تقریباً همان نتیجه را میگیرید. بعضی مشکلها با عوض کردن ابزار برطرف نمیشوند.
دو وضعیت: یک فایل docx دارید و ورد ندارید، یا ورد فایل را با پیام "Word found unreadable content" (ورد محتوای ناخوانا پیدا کرد) رد میکند. در ادامه برنامههای رایگانی که بازش میکنند، اینکه هر کدام از شما چه میخواهد، و راه بیرون کشیدن متن از فایلی که هیچکدام بازش نمیکنند آمده است.
فقط یک سطر تاریخ در قرارداد باید عوض شود. به Word که تبدیلش میکنی جدولها و حاشیهها جابهجا میشوند، و دوباره که به PDF میبری قلمها هم عوض میشوند. به خاطر یک سطر، کلّ سند چیز دیگری میشود.