PDF से Excel

PDF छोड़िए और तालिका की तरह स्तंभों में खड़ी जानकारी कोष्ठों में बँट जाती है। हर पन्ना अपनी अलग शीट बनता है, इसलिए यह कभी नहीं भूलता कि कोई अंक कहाँ से आया।

कोई अपलोड नहीं

बदलने वाली PDF

PDF में असली टेक्स्ट होना चाहिए। स्कैन की गई PDF पन्ने की तस्वीर होती है, इसलिए उसमें से निकालने को कोई टेक्स्ट नहीं होता। फ़ाइलें इसी ब्राउज़र में खुलती हैं और कभी अपलोड नहीं होतीं।

पढ़ने का क्रम, अनुच्छेद और तालिकाएँ आ जाती हैं। पन्ने पर सटीक जगह नहीं आती। PDF कभी दर्ज नहीं करती कि क्या अनुच्छेद था और क्या तालिका, इसलिए दोनों अक्षरों की जगह देखकर दोबारा बनाए जाते हैं।

पन्ने पर छपी तस्वीरें, मुहरें और हस्ताक्षर भी साथ आते हैं। सेलों के ऊपर तैरते रहें तो गणना में अड़चन डालते हैं, इसलिए हर शीट में डेटा के नीचे इकट्ठा कर दिए जाते हैं।

स्कैन की गई PDF में टेक्स्ट नहीं, तस्वीरें होती हैं, इसलिए बदलने को कुछ नहीं होता। फ़ाइल डालकर देखिए, टूल तुरंत बता देगा।

पूरे पन्ने तस्वीर बनाकर नहीं चिपकाए जाते। डाउनलोड की गई फ़ाइल Word या Excel में बदलने लायक दस्तावेज़ के रूप में खुलती है।

PDF को शीट में बदलने का तरीक़ा

  1. 1

    एक PDF छोड़िए

    दस्तावेज़ जितना तालिका जैसा होगा, नतीजा उतना अच्छा। एक साथ कई भी चलेंगी।

  2. 2

    रूपांतरण दबाइए

    अक्षर कहाँ बैठे हैं यही तय करता है कि हर तालिका कहाँ शुरू और ख़त्म होती है।

  3. 3

    XLSX उतारिए

    यह Excel या Google Sheets में गणना के लिए तैयार खुलती है।

यह औज़ार क्या करता है

यह लकीरें नहीं, जगह पढ़ता है

PDF की तालिकाओं के चारों ओर बहुत बार कोई लकीर होती ही नहीं। जहाँ होती है वहाँ वे लेख से अलग परत पर खिंची होती हैं, शब्द निकालने वाली किसी भी चीज़ के लिए अदृश्य। इसीलिए लकीरें ढूँढ़ने पर टिके तरीक़े इतनी बार नाकाम होते हैं।

इसलिए जगह पढ़ी जाती है। एक पंक्ति के भीतर, शब्दों की दूरी से कहीं अधिक चौड़ा अंतर कोष्ठ की सीमा बताता है, और जब ये अंतर लगातार कई पंक्तियों में एक ही क्षैतिज जगह पर खड़े हों तो वह हिस्सा तालिका है। कम से कम तीन पंक्तियाँ चाहिए। दो पंक्ति वाले हिस्से आम तौर पर शीर्षक के साथ दाहिने कोने में तारीख़ होते हैं, और उन्हें तालिका बनाना पढ़ना आसान नहीं, कठिन कर देता है।

ख़ाली कोष्ठ फ़ाइल में कोई निशान नहीं छोड़ता, क्योंकि वहाँ कभी कोई अक्षर था ही नहीं। कोष्ठों को क्रम से जोड़ने पर सब कुछ एक खाना खिसक जाता है, इसलिए हर कोष्ठ को अपने सबसे नज़दीकी स्तंभ में गिराया जाता है और बाक़ी ख़ाली छोड़ दिए जाते हैं।

हर पन्ने के लिए एक शीट

जब तालिकाएँ कई पन्नों पर बिखरी हों, सबको एक शीट में ढेर कर देने से पता नहीं चलता कि कोई आँकड़ा किस पन्ने से आया। इसलिए हर पन्ना अपनी शीट बनता है, जिसका नाम पन्ने की संख्या है।

जो पंक्तियाँ तालिका का हिस्सा नहीं हैं वे भी रखी जाती हैं, एक पंक्ति प्रति क़तार। तालिका के ऊपर का शीर्षक, या अंकों की इकाई बताने वाली टिप्पणी, हटा देने पर सिर्फ़ अंक बचते हैं और उन्हें पढ़ने का कोई रास्ता नहीं रहता। पन्ने पर छपे चित्र और मुहर भी साथ आते हैं, हर शीट में जानकारी के नीचे रख दिए जाते हैं ताकि वे कोष्ठों के ऊपर तैरकर गणना में बाधा न डालें।

स्कैन किए गए PDF को वापस नहीं लौटाया जा सकता

काग़ज़ की तस्वीर खींचकर या दफ़्तर के स्कैनर से बनाया गया PDF हर पन्ने के लिए एक तस्वीर भर है। आपकी आँखों को अक्षर दिखते हैं, पर फ़ाइल में एक भी नहीं होता। निकालने को कुछ नहीं, तो बनाने को भी कुछ नहीं।

यह औज़ार आपको ख़ाली फ़ाइल थमाने के बजाय साफ़ कह देता है। अगर सिर्फ़ कुछ पन्ने स्कैन हैं, तो वह बता देता है कि कौन से पन्ने ख़ाली लौटे। तस्वीरों में से अक्षर पढ़ना यह औज़ार नहीं करता।

फ़ाइल कभी आपकी मशीन से बाहर नहीं जाती

पूरा रूपांतरण इसी ब्राउज़र के भीतर होता है। PDF पढ़ना और नया दस्तावेज़ लिखना, दोनों आपके उपकरण पर चल रहे कोड का काम है। अपलोड नाम का कोई क़दम है ही नहीं।

आप ख़ुद जाँच सकते हैं। डेवलपर टूल (F12) का नेटवर्क टैब खोलकर रूपांतरण चलाइए: आपकी फ़ाइल जितना बड़ा कोई अपलोड अनुरोध या तो दिखेगा या नहीं दिखेगा।

अक्सर पूछे जाने वाले प्रश्न

क्या मेरी फ़ाइल अपलोड होती है?+

नहीं। PDF पढ़ना और शीट लिखना, दोनों इसी ब्राउज़र के भीतर होते हैं।

क्या तालिका से बाहर का लेख भी जाता है?+

हाँ, पहले स्तंभ में एक पंक्ति प्रति क़तार। तालिका के ऊपर का शीर्षक या अंकों की इकाई फेंक देने पर ऐसे अंक बचते हैं जिन्हें कोई समझ नहीं सकता।

मेरे कोष्ठ एक स्तंभ खिसक गए।+

ऐसा इसलिए होता है कि ख़ाली कोष्ठ PDF में कोई निशान नहीं छोड़ता। हर कोष्ठ को सबसे नज़दीकी स्तंभ में गिराने से यह बहुत घटा है, पर बहुत सँकरे स्तंभों वाली तालिकाएँ अब भी बेमेल हो सकती हैं।

जुड़े हुए कोष्ठों का क्या?+

जुड़े हुए कोष्ठ साथ नहीं आते। जुड़े हिस्से का मान उस एक स्तंभ में जाता है जो सबसे पास हो।

मेरे अंक लेख बनकर आए।+

PDF यह दर्ज नहीं करता कि कोई मान अंक है या नाम, इसलिए वह जैसा दिखता है वैसा ही रखा जाता है। हज़ार के विभाजक और मुद्रा चिह्न होने पर Excel उसे लेख मानता है। Excel में कोष्ठ का प्रारूप बदलने से ठीक हो जाता है।

क्या स्कैन किए PDF पर काम करता है?+

नहीं। स्कैन पन्ने की तस्वीर है और उसमें निकालने को कोई लेख नहीं।