ย้ายตารางจาก PDF เข้า Excel
ใน PDF รายงานมีตารางอยู่ และคุณต้องเอาตัวเลขพวกนั้นไปคำนวณ คุณลากคลุม คัดลอก วางลง Excel แล้วทุกค่ากองลงในช่องเดียวที่คอลัมน์ A สุดท้ายก็นั่งพิมพ์ใหม่ทีละตัว
วาง PDF ลงไป แล้วค่าที่ยืนเป็นคอลัมน์เหมือนตารางจะถูกแยกออกเป็นเซลล์ แต่ละหน้ากลายเป็นชีตของตัวเอง คุณจึงไม่หลงว่าตัวเลขมาจากหน้าไหน
ไม่อัปโหลด
PDF ที่จะแปลง
PDF ต้องมีตัวอักษรจริงอยู่ข้างใน PDF ที่สแกนมาเป็นรูปของหน้ากระดาษ จึงไม่มีตัวอักษรให้ดึงออกมา ไฟล์เปิดอยู่ในเบราว์เซอร์นี้เท่านั้นและไม่ถูกอัปโหลด
ลำดับการอ่าน ย่อหน้า และตารางจะถูกย้ายมาด้วย แต่ตำแหน่งที่แน่นอนบนหน้าจะไม่ตามมา PDF ไม่เคยบันทึกว่าส่วนไหนเป็นย่อหน้าหรือตาราง ทั้งสองอย่างจึงถูกสร้างขึ้นใหม่จากตำแหน่งของตัวอักษร
รูปภาพ ตราประทับ และลายเซ็นที่พิมพ์อยู่บนหน้าจะถูกนำมาด้วย ถ้าลอยอยู่บนเซลล์จะเกะกะการคำนวณ จึงรวมไว้ใต้ข้อมูลของแต่ละชีต
PDF ที่สแกนมาเก็บรูปถ่าย ไม่ใช่ตัวอักษร จึงไม่มีอะไรให้แปลง ลองใส่ไฟล์ดู เครื่องมือจะบอกทันที
ไม่ได้แปะทั้งหน้าเป็นรูปภาพ ไฟล์ที่ดาวน์โหลดไปเปิดแก้ไขได้ใน Word หรือ Excel
เอกสารยิ่งเป็นตารางมากเท่าไร ผลลัพธ์ยิ่งดี วางพร้อมกันหลายไฟล์ก็ได้
ตำแหน่งที่ตัวอักษรวางอยู่เป็นตัวตัดสินว่าตารางแต่ละอันเริ่มและจบตรงไหน
เปิดใน Excel หรือ Google ชีต แล้วใช้คำนวณได้เลย
ตารางใน PDF บ่อยครั้งไม่มีเส้นล้อมรอบเลย ที่มีเส้นก็ถูกวาดอยู่คนละชั้นกับข้อความ มองไม่เห็นจากฝั่งที่ดึงคำออกมา นี่คือเหตุผลที่วิธีซึ่งอาศัยการหาเส้นล้มเหลวบ่อยเหลือเกิน
สิ่งที่ถูกอ่านจึงเป็นตำแหน่ง ภายในบรรทัดหนึ่ง ช่องว่างที่กว้างกว่าช่องว่างระหว่างคำมาก หมายถึงขอบเขตของเซลล์ และเมื่อช่องว่างเหล่านั้นยืนที่ตำแหน่งแนวนอนเดียวกันติดต่อกันหลายบรรทัด กลุ่มนั้นคือตาราง อย่างน้อยต้องสามบรรทัด กลุ่มสองบรรทัดมักเป็นหัวเรื่องกับวันที่ที่ถูกดันไปขวาสุด การทำให้เป็นตารางมีแต่จะอ่านยากขึ้น
เซลล์ว่างไม่ทิ้งร่องรอยไว้ในไฟล์ เพราะตรงนั้นไม่เคยมีตัวอักษรอยู่เลย การต่อเซลล์เรียงกันไปจะทำให้ทุกอย่างเลื่อนไปหนึ่งช่อง แต่ละเซลล์จึงถูกหย่อนลงคอลัมน์ที่ใกล้ที่สุด ส่วนที่เหลือปล่อยว่าง
เมื่อตารางกระจายอยู่หลายหน้า การกองรวมไว้ในชีตเดียวทำให้ไม่รู้ว่าตัวเลขมาจากหน้าไหน แต่ละหน้าจึงกลายเป็นชีตของตัวเอง ตั้งชื่อตามเลขหน้า
บรรทัดที่ไม่ได้เป็นส่วนของตารางก็ถูกเก็บไว้ บรรทัดละแถว การทิ้งหัวเรื่องเหนือตาราง หรือบรรทัดที่บอกว่าตัวเลขใช้หน่วยอะไร จะเหลือแต่ตัวเลขที่ไม่มีใครอ่านออก รูปภาพและตราประทับบนหน้าก็ถูกนำมาด้วย โดยวางไว้ใต้ข้อมูลของแต่ละชีต เพื่อไม่ให้ลอยทับช่องและขวางการคำนวณ
PDF ที่ทำจากการถ่ายรูปกระดาษหรือสแกนด้วยเครื่องถ่ายเอกสาร คือภาพหนึ่งภาพต่อหนึ่งหน้า ตาคุณเห็นเป็นตัวหนังสือ แต่ในไฟล์ไม่มีตัวอักษรแม้แต่ตัวเดียว ไม่มีอะไรให้ดึงออกมา จึงไม่มีอะไรให้ประกอบขึ้นใหม่
เครื่องมือนี้บอกตรง ๆ แทนที่จะยื่นไฟล์เปล่าให้ ถ้ามีแค่บางหน้าที่เป็นภาพสแกน มันจะระบุว่าหน้าไหนบ้างที่ว่าง การอ่านตัวอักษรออกจากรูปภาพไม่ใช่สิ่งที่เครื่องมือนี้ทำ
การแปลงทั้งหมดเกิดขึ้นในเบราว์เซอร์นี้ ทั้งการอ่าน PDF และการเขียนเอกสารใหม่ ล้วนทำโดยโค้ดที่รันอยู่บนอุปกรณ์ของคุณ ไม่มีขั้นตอนอัปโหลดเลย
คุณตรวจสอบเองได้ เปิดแท็บเน็ตเวิร์กในเครื่องมือนักพัฒนา (F12) แล้วสั่งแปลง จะมีคำขออัปโหลดขนาดเท่าไฟล์ของคุณหรือไม่ เห็นได้ทันที
ไม่ ทั้งการอ่าน PDF และการเขียนสเปรดชีตเกิดขึ้นในเบราว์เซอร์นี้
ใส่ บรรทัดละแถวในคอลัมน์แรก การทิ้งหัวเรื่องเหนือตารางหรือหน่วยของตัวเลขจะเหลือแต่ตัวเลขที่ไม่มีใครตีความได้
เกิดขึ้นเพราะเซลล์ว่างไม่ทิ้งร่องรอยใน PDF การหย่อนแต่ละเซลล์ลงคอลัมน์ที่ใกล้ที่สุดช่วยได้มาก แต่ตารางที่ระยะคอลัมน์แคบมากก็ยังเลื่อนได้
เซลล์ที่ผสานกันไม่ถูกนำข้ามมา ค่าจากบล็อกที่ผสานจะลงในคอลัมน์เดียวที่ใกล้ที่สุด
PDF ไม่บันทึกว่าค่าหนึ่งเป็นตัวเลขหรือป้ายกำกับ จึงเก็บตามที่ปรากฏ เครื่องหมายคั่นหลักพันและสัญลักษณ์สกุลเงินทำให้ Excel อ่านเป็นข้อความ เปลี่ยนรูปแบบเซลล์ใน Excel ก็แก้ได้
ไม่ได้ ไฟล์สแกนคือภาพของหน้ากระดาษและไม่มีข้อความให้ดึงออกมา
ใน PDF รายงานมีตารางอยู่ และคุณต้องเอาตัวเลขพวกนั้นไปคำนวณ คุณลากคลุม คัดลอก วางลง Excel แล้วทุกค่ากองลงในช่องเดียวที่คอลัมน์ A สุดท้ายก็นั่งพิมพ์ใหม่ทีละตัว
คุณแปลง PDF เป็น Word แล้วตารางออกมาเบี้ยว คุณคิดว่าตัวแปลงไม่ดี ลองอีกตัวก็ได้ผลใกล้เคียงกัน ปัญหาบางอย่างไม่หายไปด้วยการเปลี่ยนเครื่องมือ