เมื่อ PDF กลายเป็นไฟล์ Word อะไรเหลืออยู่ อะไรหายไป
คุณแปลง PDF เป็น Word แล้วตารางออกมาเบี้ยว คุณคิดว่าตัวแปลงไม่ดี ลองอีกตัวก็ได้ผลใกล้เคียงกัน ปัญหาบางอย่างไม่หายไปด้วยการเปลี่ยนเครื่องมือ
วาง PDF ลงไป แล้วข้อความข้างในจะถูกประกอบกลับเป็นย่อหน้าและตารางในไฟล์ Word ไม่มีอะไรถูกแปะเข้าไปเป็นภาพของหน้ากระดาษ สิ่งที่คุณดาวน์โหลดจึงเป็นเอกสารที่แก้ไขได้ทันที
ไม่อัปโหลด
PDF ที่จะแปลง
PDF ต้องมีตัวอักษรจริงอยู่ข้างใน PDF ที่สแกนมาเป็นรูปของหน้ากระดาษ จึงไม่มีตัวอักษรให้ดึงออกมา ไฟล์เปิดอยู่ในเบราว์เซอร์นี้เท่านั้นและไม่ถูกอัปโหลด
ลำดับการอ่าน ย่อหน้า และตารางจะถูกย้ายมาด้วย แต่ตำแหน่งที่แน่นอนบนหน้าจะไม่ตามมา PDF ไม่เคยบันทึกว่าส่วนไหนเป็นย่อหน้าหรือตาราง ทั้งสองอย่างจึงถูกสร้างขึ้นใหม่จากตำแหน่งของตัวอักษร
รูปภาพ ตราประทับ และลายเซ็นที่พิมพ์อยู่บนหน้าจะถูกดึงออกมาใส่ในเอกสารด้วย โดยวางตามลำดับการอ่าน ไม่ใช่พิกัดเดิม
PDF ที่สแกนมาเก็บรูปถ่าย ไม่ใช่ตัวอักษร จึงไม่มีอะไรให้แปลง ลองใส่ไฟล์ดู เครื่องมือจะบอกทันที
ไม่ได้แปะทั้งหน้าเป็นรูปภาพ ไฟล์ที่ดาวน์โหลดไปเปิดแก้ไขได้ใน Word หรือ Excel
ไฟล์ต้องมีข้อความจริงอยู่ข้างใน วางพร้อมกันหลายไฟล์ก็ได้
แต่ละหน้าจะถูกอ่านว่าตัวอักษรวางอยู่ตรงไหน แล้วจัดกลุ่มเป็นย่อหน้าและตาราง ความคืบหน้าแสดงเป็นเลขหน้า
เปิดใน Word แล้วแก้ไขได้เลย ไฟล์ PDF ต้นฉบับไม่ถูกแตะต้อง
PDF ไม่ใช่รูปแบบสำหรับเก็บข้อความ แต่เป็นรูปแบบสำหรับวาดหน้ากระดาษ สิ่งที่อยู่ในไฟล์คือรายการคำสั่งยาว ๆ ที่บอกว่าให้พิมพ์ตัวอักษรนี้ตรงนี้ และไม่มีที่ใดบันทึกว่าย่อหน้าจบตรงไหนหรือกลุ่มตัวเลขไหนเคยเป็นตาราง ข้อมูลนั้นถูกทิ้งไปตั้งแต่ตอนที่เอกสารถูกส่งออกเป็น PDF
ดังนั้นนี่คือการประกอบขึ้นใหม่ ไม่ใช่การแปลง ตำแหน่งที่ตัวอักษรวางอยู่ ระยะห่างระหว่างบรรทัด และขนาดตัวอักษร ถูกอ่านย้อนกลับเพื่อเดารูปร่างเดิม ช่องว่างที่กว้างกว่าปกติ หรือบรรทัดที่จบก่อนถึงขอบขวามาก หมายความว่าย่อหน้าจบตรงนั้น ช่องที่ขอบซ้ายยืนตรงตำแหน่งเดียวกันหลายบรรทัดหมายถึงตาราง
เมื่อเป็นการเดา ก็ผิดพลาดได้ สิ่งที่มันจะไม่ทำคือแต่งค่าที่ไม่ได้เจอขึ้นมา หน้าที่ไม่มีข้อความจะถูกรายงานว่าว่าง และเอกสารที่สร้างเสร็จจะถูกอ่านกลับเพื่อตรวจก่อนส่งถึงคุณ
ลำดับการอ่าน ย่อหน้า หัวข้อ และตาราง ตามมาทั้งหมด รวมถึงการขึ้นหน้าใหม่ด้วย รูปภาพ ตราประทับ และลายเซ็นบนหน้าก็ถูกดึงออกมาใส่ให้ด้วย เพียงแต่วางตามลำดับการอ่าน ไม่ใช่ตามพิกัดเดิม สิ่งที่ไม่ตามมาคือตำแหน่งที่แน่นอนบนหน้า แบบอักษร และสีตัวอักษร
การจัดวางไม่ได้ถูกเลียนแบบโดยตั้งใจ การทำซ้ำตำแหน่งหมายถึงโปรยกล่องข้อความไว้ที่พิกัดตายตัว และเอกสารที่สร้างแบบนั้นเปิดได้ก็จริงแต่พังทันทีที่คุณแก้บรรทัดเดียว จุดประสงค์ของเครื่องมือนี้คือเอกสารที่คุณทำงานต่อได้
| รายการ | ตามมาหรือไม่ |
|---|---|
| ลำดับการอ่านและถ้อยคำ | ตามมา |
| การแบ่งย่อหน้า | ประกอบใหม่จากตำแหน่ง |
| หัวข้อ | ตัวอักษรที่ใหญ่กว่าเนื้อความถือเป็นหัวข้อ |
| ตาราง | ประกอบใหม่จากค่าที่เรียงตรงกัน |
| การขึ้นหน้าใหม่ | ตามมา |
| แบบอักษร สี การจัดวางที่แน่นอน | ไม่ตามมา |
| รูปภาพ ตราประทับ ลายเซ็น | ตามมา วางตามลำดับการอ่าน |
PDF ที่ทำจากการถ่ายรูปกระดาษหรือสแกนด้วยเครื่องถ่ายเอกสาร คือภาพหนึ่งภาพต่อหนึ่งหน้า ตาคุณเห็นเป็นตัวหนังสือ แต่ในไฟล์ไม่มีตัวอักษรแม้แต่ตัวเดียว ไม่มีอะไรให้ดึงออกมา จึงไม่มีอะไรให้ประกอบขึ้นใหม่
เครื่องมือนี้บอกตรง ๆ แทนที่จะยื่นไฟล์เปล่าให้ ถ้ามีแค่บางหน้าที่เป็นภาพสแกน มันจะระบุว่าหน้าไหนบ้างที่ว่าง การอ่านตัวอักษรออกจากรูปภาพไม่ใช่สิ่งที่เครื่องมือนี้ทำ
การแปลงทั้งหมดเกิดขึ้นในเบราว์เซอร์นี้ ทั้งการอ่าน PDF และการเขียนเอกสารใหม่ ล้วนทำโดยโค้ดที่รันอยู่บนอุปกรณ์ของคุณ ไม่มีขั้นตอนอัปโหลดเลย
คุณตรวจสอบเองได้ เปิดแท็บเน็ตเวิร์กในเครื่องมือนักพัฒนา (F12) แล้วสั่งแปลง จะมีคำขออัปโหลดขนาดเท่าไฟล์ของคุณหรือไม่ เห็นได้ทันที
ไม่ ทั้งการอ่าน PDF และการเขียนไฟล์ Word เกิดขึ้นในเบราว์เซอร์นี้ ไม่ต้องมีบัญชีและไม่ต้องติดตั้งอะไร
ไม่ ถ้อยคำ ลำดับการอ่าน ย่อหน้า และตาราง ตามมา แต่การจัดวางบนหน้าไม่ถูกทำซ้ำ การเลียนแบบมันหมายถึงตรึงกล่องข้อความไว้ที่พิกัด และเอกสารแบบนั้นแก้ไขไม่ได้
ตารางใน PDF มักไม่มีเส้น และที่มีเส้นก็ถูกวาดอยู่คนละชั้นซึ่งการดึงข้อความมองไม่เห็น เราจึงหาตารางจากการดูว่าช่องเรียงตรงกันลงมาหรือไม่ ระยะคอลัมน์ที่แคบและช่องที่ผสานกันทำให้คลาดเคลื่อนได้
ไม่ได้ ไฟล์สแกนคือภาพของหน้ากระดาษและไม่มีข้อความเลย ลองวางเข้ามาแล้วเครื่องมือจะบอกทันที
ได้ ถ้าคุณรู้รหัสผ่าน เมื่อเจอไฟล์ที่เข้ารหัสจะมีช่องรหัสผ่านปรากฏขึ้น ใส่แล้วสั่งแปลงอีกครั้ง
ไม่ได้ตั้งขีดจำกัด แต่ทุกอย่างรันบนเครื่องคุณ เอกสารที่ยาวมากจึงใช้เวลานานตามสัดส่วน คอมพิวเตอร์จัดการได้เร็วกว่าโทรศัพท์
คุณแปลง PDF เป็น Word แล้วตารางออกมาเบี้ยว คุณคิดว่าตัวแปลงไม่ดี ลองอีกตัวก็ได้ผลใกล้เคียงกัน ปัญหาบางอย่างไม่หายไปด้วยการเปลี่ยนเครื่องมือ
มีสองสถานการณ์ คุณมีไฟล์ .docx แต่ไม่มี Word หรือ Word ไม่ยอมเปิดไฟล์และขึ้นว่า “Word found unreadable content” ข้างล่างคือโปรแกรมฟรีที่เปิดไฟล์ได้ แต่ละตัวต้องการอะไรจากคุณ และวิธีดึงข้อความออกจากไฟล์ที่ไม่มีโปรแกรมไหนเปิดได้เลย
ในสัญญาต้องแก้แค่บรรทัดวันที่บรรทัดเดียว พอแปลงเป็น Word ตารางกับระยะขอบก็เพี้ยน แล้วพอส่งกลับเป็น PDF ฟอนต์ก็เปลี่ยนอีก แค่บรรทัดเดียวแต่ทั้งเอกสารกลายเป็นคนละฉบับ