PDF 轉成 Word 後,什麼留下了,什麼消失了
把 PDF 轉成 Word,表格歪了。你以為是轉換器不行,換一個再試,結果差不多。有些問題不是換工具就能解決的。
放入 PDF,裡面的文字會被還原成段落與表格,產生 Word 檔。不是把頁面當成圖片貼上去,而是當作真正的段落寫進去,所以拿到的檔案可以在 Word 裡直接改。
不上傳
要轉換的 PDF
PDF 裡必須有真正的文字。掃描的 PDF 每一頁都是圖片,沒有可以取出的文字。檔案只會在這個瀏覽器裡開啟,不會上傳。
會搬過去的是閱讀順序、段落和表格,頁面上的精確版面不會照搬。PDF 從不記錄哪裡是段落、哪裡是表格,這兩樣都是依文字所在的位置重建出來的。
頁面上的圖片、印章和簽名也會取出來放進文件,位置依閱讀順序排列,而不是原本的座標。
掃描的 PDF 裡裝的是照片而不是文字,所以沒有東西可以轉換。放進來試試,工具會直接告訴你。
不會把整頁當成圖片貼進去。下載的檔案可以直接在 Word 或 Excel 裡編輯。
需要是帶文字的 PDF。一次放多個也可以。
逐頁讀取文字的位置,歸併成段落與表格。進度會依頁碼顯示。
用 Word 開啟就能改。原本的 PDF 不受影響。
PDF 不是裝文字的格式,而是畫頁面的格式。檔案裡存著的只是「在這裡印下這個字」這樣的指令,段落在哪裡斷開、哪一塊是表格,任何地方都沒有紀錄。文件匯出成 PDF 的那一刻,這些資訊就被丟掉了。
所以還原不是轉換,而是重建。靠文字擺放的位置、行距和字級來推測原本的樣子。行距比平常寬,或者上一行沒寫到右邊界就結束了,就認為段落在那裡斷開。若干行裡格子的左緣站在同一個位置,就認為那是表格。
既然是推測,就可能出錯。但它不會編造沒找到的值。沒有文字的頁會明確說沒有,做好的文件還會被讀回來核對,結果一併告訴你。
文字的順序與段落、標題、表格都能帶過來,分頁也照樣保留。頁面上的圖片、印章與簽名也會被取出並放進去,只是位置依文字順序排,而不是原本的座標。帶不過來的是頁面內的精確排版、字體與文字顏色。
不去硬湊版面是有原因的。要把位置原樣搬過去,就得擺一堆文字方塊釘在座標上,這樣做出來的文件雖然能開啟,但改一行就散了。這個工具的目的是給你一份能改的文件。
| 項目 | 能否帶過來 |
|---|---|
| 文字順序與內容 | 能 |
| 段落劃分 | 依位置重建 |
| 標題 | 比內文大的字級視為標題 |
| 表格 | 從對齊的值重建 |
| 分頁 | 能 |
| 字體、顏色、精確排版 | 不能 |
| 圖片、印章、簽名 | 能。位置依文字順序排 |
拍紙張或用事務機掃出來的 PDF,整頁就是一張照片。人眼看著是字,檔案裡卻一個字也沒有。沒有東西可取,自然也沒有東西可還原。
這個工具不會默默略過,而是明確告訴你。如果只有部分頁是掃描件,它會用頁碼說明哪幾頁是空的。辨識圖片裡文字的功能尚未加入。
整個轉換都在這個瀏覽器裡完成。讀取 PDF 和寫出新文件,都是在你裝置上執行的程式做的。根本沒有上傳這一步。
你可以自己驗證。打開開發者工具(F12)的網路面板,然後按轉換:有沒有一個和檔案差不多大的上傳請求,當場就看得見。
不會。從讀取 PDF 到寫出 Word 檔,全部在這個瀏覽器裡完成。不需要註冊,也不用安裝。
不會。文字內容、順序、段落與表格都會搬過去,但頁面內的排版不會照搬。要照搬就得用文字方塊釘座標,那樣的文件沒辦法編輯。
PDF 裡的表格常常沒有線,即使有線也畫在與文字不同的圖層上,取文字時看不到。所以這裡靠格子是否上下對齊來找表格。欄距很窄或有合併儲存格時可能出錯。
不行。掃描件整頁都是照片,檔案裡沒有文字。放進來試一下,工具會立刻告訴你。
知道密碼就可以。遇到加密檔案時頁面上會出現密碼欄,填進去再按一次即可。
沒有設上限。不過所有處理都在你的裝置上跑,文件很長就相應地更慢。電腦比手機快。
把 PDF 轉成 Word,表格歪了。你以為是轉換器不行,換一個再試,結果差不多。有些問題不是換工具就能解決的。
兩種情況:你手上有 .docx 卻沒有 Word,或是 Word 以「Word found unreadable content」(Word 發現無法讀取的內容)拒絕打開檔案。以下整理能打開它的免費程式、各自需要你準備什麼,以及這些程式都打不開時,怎麼把文字拿出來。
合約裡只要改一個日期。轉成 Word 去改,表格和邊界全亂了;再匯回 PDF,字型又變了。為了一行,整份文件都不一樣了。