ย้ายตารางจาก PDF เข้า Excel
ใน PDF รายงานมีตารางอยู่ และคุณต้องเอาตัวเลขพวกนั้นไปคำนวณ คุณลากคลุม คัดลอก วางลง Excel แล้วทุกค่ากองลงในช่องเดียวที่คอลัมน์ A สุดท้ายก็นั่งพิมพ์ใหม่ทีละตัว
รู้ว่าทำไมถึงเป็นแบบนั้น ส่วนใหญ่ก็ไม่ต้องพิมพ์ใหม่แล้ว
ทำไมคัดลอกแล้ววางจึงกองรวมในช่องเดียว
เพราะใน PDF ไม่มีสิ่งที่เรียกว่าตารางอยู่เลย ไฟล์เก็บคำสั่งแบบว่าให้พิมพ์ 1,204 ที่ตำแหน่ง 220, 540 และข้อเท็จจริงที่ว่าค่านั้นเคยเป็นแถวที่สามของคอลัมน์ที่สอง ไม่มีที่ใดบันทึกไว้ โครงสร้างนั้นถูกทิ้งตั้งแต่ตอนที่เอกสารถูกส่งออกเป็น PDF
ฟังก์ชันคัดลอกจึงแค่ร้อยอักขระตามลำดับที่มันเห็น ช่องว่างระหว่างช่องหนึ่งกับอีกช่องไม่ใช่แท็บและไม่ใช่จุลภาค เป็นเพียงผลต่างของพิกัด ฝั่งที่รับวางจึงไม่มีอะไรให้ใช้แยก
ข้อเท็จจริงเดียวนี้อธิบายที่เหลือทั้งหมด การประกอบตารางขึ้นใหม่ต้องอ่านตำแหน่งที่ค่าวางอยู่ ไม่ใช่อ่านเส้นหรือแท็ก และการอ่านตำแหน่งเป็นการอนุมานเสมอ
ปัญหาตัวเลขเข้ามาเป็นข้อความ
แม้ช่องจะแยกถูกต้อง Excel ก็มักไม่ยอมนับค่าพวกนั้นเป็นตัวเลข เพราะ PDF ไม่บันทึกว่าค่าหนึ่งเป็นตัวเลขหรือป้ายกำกับ จึงย้ายมาตามที่ปรากฏ ส่วนใหญ่แก้ได้ด้วยไม่กี่ขั้นตอนใน Excel
| ถ้าเข้ามาแบบนี้ | สาเหตุและวิธีแก้ |
|---|---|
| 1,204 ชิดซ้าย | เครื่องหมายคั่นหลักพันทำให้ Excel อ่านเป็นข้อความ เปลี่ยนรูปแบบเซลล์เป็นตัวเลข หรือใช้ค้นหาและแทนที่เพื่อลบจุลภาค |
| ฿18,400,000 บวกไม่ได้ | มีสัญลักษณ์สกุลเงินนำหน้า ลบสัญลักษณ์ออกแล้วตั้งรูปแบบเซลล์เป็นสกุลเงินแทน |
| (1,204) ไม่ถูกมองเป็นค่าลบ | เป็นการเขียนค่าลบในวงเล็บแบบบัญชี ถ้า Excel ไม่รู้จัก ให้เอาวงเล็บออกแล้วเติมเครื่องหมายลบข้างหน้า |
| 38% ไม่เท่ากับ 0.38 | เป็นข้อความที่มีเครื่องหมายเปอร์เซ็นต์ติดอยู่ ลบเครื่องหมายแล้วตั้งรูปแบบเซลล์เป็นเปอร์เซ็นต์ |
| 1204 ตัวเลขกว้างผิดปกติ | เป็นตัวเลขความกว้างเต็ม พบในเอกสารเอเชียตะวันออก ใช้สูตรแปลงเป็นความกว้างครึ่ง |
| เลขอ้างอิงกลายเป็นวันที่ | กรณีตรงข้าม Excel เดาเร็วเกินไป ให้ตั้งรูปแบบคอลัมน์เป็นข้อความก่อนวาง |
เมื่อช่องเลื่อนไปหนึ่งคอลัมน์
เซลล์ว่างคือต้นเหตุ เซลล์ว่างไม่ทิ้งร่องรอยใน PDF เลย ไม่มีอักขระจึงไม่มีคำสั่งให้พิมพ์ แถวนั้นจึงดูเหมือนมีช่องน้อยไปหนึ่ง และทุกอย่างหลังจากนั้นเลื่อนไปหนึ่งช่อง
ฝั่งเครื่องมือลดปัญหานี้ด้วยการหย่อนแต่ละค่าลงคอลัมน์ที่ใกล้ที่สุด แต่ตารางที่ระยะคอลัมน์แคบมากก็ยังเบี้ยวได้ เซลล์ที่ผสานกันก็เช่นกัน ตาคุณเห็นสองช่องรวมเป็นหนึ่ง แต่ในไฟล์มีแค่ข้อความชิ้นหนึ่งวางเยื้องซ้ายกว่าเพื่อนบ้านเล็กน้อย
PDF แบบไหนที่ได้ผลดี
ต้นฉบับถูกสร้างมาอย่างไรเป็นตัวตัดสินผลลัพธ์
- ได้ผลดี ตารางที่สร้างใน Excel หรือ Word แล้วส่งออกเป็น PDF คอลัมน์ตั้งตรง ดูแค่ตำแหน่งก็แยกช่องได้
- ก้ำกึ่ง รายงานที่จัดหน้าด้วยโปรแกรมจัดพิมพ์ การจัดกึ่งกลางและการเยื้องปนกันทำให้ขอบซ้ายของคอลัมน์ส่าย
- ไม่ได้ผล PDF ที่สแกนมา ทุกหน้าเป็นภาพถ่ายและไม่มีข้อความให้ดึงเลย นี่ไม่ใช่ข้อบกพร่องของเครื่องมือ
- ต้องระวัง ตารางยาวที่พาดหลายหน้า หัวตารางจะซ้ำในทุกหน้า หลังย้ายเสร็จให้ลบแถวหัวตารางที่ซ้ำออก
ย้ายเสร็จแล้วต้องตรวจทานเสมอ
การย้ายตารางมีการอนุมานปนอยู่ จึงอาจพลาดแบบเงียบ ๆ ได้ ค่าหายไปหนึ่งตัวหรือเลื่อนไปหนึ่งคอลัมน์ หน้าจอก็ยังดูเรียบร้อยอยู่ดี
ถ้าต้นฉบับมีแถวผลรวม นั่นคือที่ตรวจที่ดีที่สุด รวมคอลัมน์เดียวกันใน Excel แล้วเทียบกับผลรวมที่พิมพ์ไว้ ถ้าไม่มีแถวผลรวม อย่างน้อยก็นับจำนวนแถวและคอลัมน์ การตรวจครั้งเดียวนี้ถูกกว่าการเขียนรายงานด้วยตัวเลขผิดมาก
คำถามที่พบบ่อย
- มีวิธีดึงเฉพาะตารางออกมาไหม
- แยก PDF ให้เหลือเฉพาะหน้าที่มีตารางก่อนแล้วค่อยแปลง ผลลัพธ์จะสะอาดกว่า ถ้ามีย่อหน้าเนื้อความปนอยู่ เครื่องมือก็ต้องตัดสินใจมากขึ้นว่าตารางเริ่มตรงไหน
- ตัวเลขของฉันเข้ามาเป็นข้อความหมดเลย
- PDF ไม่บันทึกว่าค่าหนึ่งเป็นตัวเลขหรือป้ายกำกับ จึงเก็บตามที่ปรากฏ เลือกคอลัมน์นั้นใน Excel แล้วสั่ง Text to Columns จากแท็บ Data หนึ่งครั้ง มักเปลี่ยนเป็นตัวเลขทั้งหมดในทีเดียว
- ตารางที่มีเซลล์ผสานจะเป็นอย่างไร
- เซลล์ที่ผสานกันย้ายมาไม่ได้ ค่าจากบล็อกที่ผสานจะลงในคอลัมน์เดียวที่ใกล้ที่สุด ผสานใหม่ใน Excel หลังจากนั้นเร็วกว่า
- แล้วตารางที่พาดหลายหน้าล่ะ
- แต่ละหน้าจะกลายเป็นชีตของตัวเอง ถ้าจะต่อกัน ให้คัดลอกชีตหนึ่งไปวางใต้อีกชีต แล้วลบแถวหัวตารางที่ซ้ำออก
- PDF ที่สแกนมาไม่มีทางจริง ๆ หรือ
- ด้วยวิธีดึงข้อความก็ไม่มีทางจริง ๆ ไฟล์สแกนคือภาพถ่ายของหน้ากระดาษและไม่มีข้อความอยู่ ขอไฟล์ต้นฉบับจากผู้ออกเอกสารมักเร็วกว่า
อัปเดต 17 กันยายน 2569