PDF เป็น Excel

วาง PDF ลงไป แล้วค่าที่ยืนเป็นคอลัมน์เหมือนตารางจะถูกแยกออกเป็นเซลล์ แต่ละหน้ากลายเป็นชีตของตัวเอง คุณจึงไม่หลงว่าตัวเลขมาจากหน้าไหน

ไม่อัปโหลด

PDF ที่จะแปลง

PDF ต้องมีตัวอักษรจริงอยู่ข้างใน PDF ที่สแกนมาเป็นรูปของหน้ากระดาษ จึงไม่มีตัวอักษรให้ดึงออกมา ไฟล์เปิดอยู่ในเบราว์เซอร์นี้เท่านั้นและไม่ถูกอัปโหลด

ลำดับการอ่าน ย่อหน้า และตารางจะถูกย้ายมาด้วย แต่ตำแหน่งที่แน่นอนบนหน้าจะไม่ตามมา PDF ไม่เคยบันทึกว่าส่วนไหนเป็นย่อหน้าหรือตาราง ทั้งสองอย่างจึงถูกสร้างขึ้นใหม่จากตำแหน่งของตัวอักษร

รูปภาพ ตราประทับ และลายเซ็นที่พิมพ์อยู่บนหน้าจะถูกนำมาด้วย ถ้าลอยอยู่บนเซลล์จะเกะกะการคำนวณ จึงรวมไว้ใต้ข้อมูลของแต่ละชีต

PDF ที่สแกนมาเก็บรูปถ่าย ไม่ใช่ตัวอักษร จึงไม่มีอะไรให้แปลง ลองใส่ไฟล์ดู เครื่องมือจะบอกทันที

ไม่ได้แปะทั้งหน้าเป็นรูปภาพ ไฟล์ที่ดาวน์โหลดไปเปิดแก้ไขได้ใน Word หรือ Excel

วิธีเปลี่ยน PDF เป็นสเปรดชีต

  1. 1

    วาง PDF ลงไป

    เอกสารยิ่งเป็นตารางมากเท่าไร ผลลัพธ์ยิ่งดี วางพร้อมกันหลายไฟล์ก็ได้

  2. 2

    กดแปลง

    ตำแหน่งที่ตัวอักษรวางอยู่เป็นตัวตัดสินว่าตารางแต่ละอันเริ่มและจบตรงไหน

  3. 3

    ดาวน์โหลด XLSX

    เปิดใน Excel หรือ Google ชีต แล้วใช้คำนวณได้เลย

เครื่องมือนี้ทำอะไร

มันอ่านตำแหน่ง ไม่ได้อ่านเส้น

ตารางใน PDF บ่อยครั้งไม่มีเส้นล้อมรอบเลย ที่มีเส้นก็ถูกวาดอยู่คนละชั้นกับข้อความ มองไม่เห็นจากฝั่งที่ดึงคำออกมา นี่คือเหตุผลที่วิธีซึ่งอาศัยการหาเส้นล้มเหลวบ่อยเหลือเกิน

สิ่งที่ถูกอ่านจึงเป็นตำแหน่ง ภายในบรรทัดหนึ่ง ช่องว่างที่กว้างกว่าช่องว่างระหว่างคำมาก หมายถึงขอบเขตของเซลล์ และเมื่อช่องว่างเหล่านั้นยืนที่ตำแหน่งแนวนอนเดียวกันติดต่อกันหลายบรรทัด กลุ่มนั้นคือตาราง อย่างน้อยต้องสามบรรทัด กลุ่มสองบรรทัดมักเป็นหัวเรื่องกับวันที่ที่ถูกดันไปขวาสุด การทำให้เป็นตารางมีแต่จะอ่านยากขึ้น

เซลล์ว่างไม่ทิ้งร่องรอยไว้ในไฟล์ เพราะตรงนั้นไม่เคยมีตัวอักษรอยู่เลย การต่อเซลล์เรียงกันไปจะทำให้ทุกอย่างเลื่อนไปหนึ่งช่อง แต่ละเซลล์จึงถูกหย่อนลงคอลัมน์ที่ใกล้ที่สุด ส่วนที่เหลือปล่อยว่าง

หน้าละหนึ่งชีต

เมื่อตารางกระจายอยู่หลายหน้า การกองรวมไว้ในชีตเดียวทำให้ไม่รู้ว่าตัวเลขมาจากหน้าไหน แต่ละหน้าจึงกลายเป็นชีตของตัวเอง ตั้งชื่อตามเลขหน้า

บรรทัดที่ไม่ได้เป็นส่วนของตารางก็ถูกเก็บไว้ บรรทัดละแถว การทิ้งหัวเรื่องเหนือตาราง หรือบรรทัดที่บอกว่าตัวเลขใช้หน่วยอะไร จะเหลือแต่ตัวเลขที่ไม่มีใครอ่านออก รูปภาพและตราประทับบนหน้าก็ถูกนำมาด้วย โดยวางไว้ใต้ข้อมูลของแต่ละชีต เพื่อไม่ให้ลอยทับช่องและขวางการคำนวณ

PDF ที่สแกนมาย้อนกลับไม่ได้

PDF ที่ทำจากการถ่ายรูปกระดาษหรือสแกนด้วยเครื่องถ่ายเอกสาร คือภาพหนึ่งภาพต่อหนึ่งหน้า ตาคุณเห็นเป็นตัวหนังสือ แต่ในไฟล์ไม่มีตัวอักษรแม้แต่ตัวเดียว ไม่มีอะไรให้ดึงออกมา จึงไม่มีอะไรให้ประกอบขึ้นใหม่

เครื่องมือนี้บอกตรง ๆ แทนที่จะยื่นไฟล์เปล่าให้ ถ้ามีแค่บางหน้าที่เป็นภาพสแกน มันจะระบุว่าหน้าไหนบ้างที่ว่าง การอ่านตัวอักษรออกจากรูปภาพไม่ใช่สิ่งที่เครื่องมือนี้ทำ

ไฟล์ไม่เคยออกจากเครื่องคุณ

การแปลงทั้งหมดเกิดขึ้นในเบราว์เซอร์นี้ ทั้งการอ่าน PDF และการเขียนเอกสารใหม่ ล้วนทำโดยโค้ดที่รันอยู่บนอุปกรณ์ของคุณ ไม่มีขั้นตอนอัปโหลดเลย

คุณตรวจสอบเองได้ เปิดแท็บเน็ตเวิร์กในเครื่องมือนักพัฒนา (F12) แล้วสั่งแปลง จะมีคำขออัปโหลดขนาดเท่าไฟล์ของคุณหรือไม่ เห็นได้ทันที

คำถามที่พบบ่อย

ไฟล์ของฉันถูกอัปโหลดไหม+

ไม่ ทั้งการอ่าน PDF และการเขียนสเปรดชีตเกิดขึ้นในเบราว์เซอร์นี้

ข้อความที่ไม่ใช่ตารางถูกใส่เข้าไปด้วยไหม+

ใส่ บรรทัดละแถวในคอลัมน์แรก การทิ้งหัวเรื่องเหนือตารางหรือหน่วยของตัวเลขจะเหลือแต่ตัวเลขที่ไม่มีใครตีความได้

เซลล์ของฉันเลื่อนไปหนึ่งคอลัมน์+

เกิดขึ้นเพราะเซลล์ว่างไม่ทิ้งร่องรอยใน PDF การหย่อนแต่ละเซลล์ลงคอลัมน์ที่ใกล้ที่สุดช่วยได้มาก แต่ตารางที่ระยะคอลัมน์แคบมากก็ยังเลื่อนได้

แล้วเซลล์ที่ผสานกันล่ะ+

เซลล์ที่ผสานกันไม่ถูกนำข้ามมา ค่าจากบล็อกที่ผสานจะลงในคอลัมน์เดียวที่ใกล้ที่สุด

ตัวเลขของฉันกลายเป็นข้อความ+

PDF ไม่บันทึกว่าค่าหนึ่งเป็นตัวเลขหรือป้ายกำกับ จึงเก็บตามที่ปรากฏ เครื่องหมายคั่นหลักพันและสัญลักษณ์สกุลเงินทำให้ Excel อ่านเป็นข้อความ เปลี่ยนรูปแบบเซลล์ใน Excel ก็แก้ได้

ใช้กับ PDF ที่สแกนมาได้ไหม+

ไม่ได้ ไฟล์สแกนคือภาพของหน้ากระดาษและไม่มีข้อความให้ดึงออกมา