PDF की तालिका को Excel में लाना
किसी रिपोर्ट PDF में तालिका है और आपको उन अंकों पर गणना करनी है। आप उसे चुनते हैं, कॉपी करते हैं, Excel में पेस्ट करते हैं, और सारे मान A स्तंभ के एक ही ख़ाने में गिर जाते हैं। आख़िर में आप हाथ से दोबारा टाइप करते हैं।
ऐसा क्यों होता है यह जान लेने पर ज़्यादातर बार दोबारा टाइप करने से बच जाते हैं।
कॉपी-पेस्ट करने पर सब कुछ एक ख़ाने में क्यों जाता है
क्योंकि PDF के भीतर तालिका नाम की कोई चीज़ है ही नहीं। फ़ाइल में ऐसे निर्देश होते हैं कि 220, 540 पर 1,204 छापो, और यह तथ्य कि वह मान दूसरे स्तंभ की तीसरी क़तार था, कहीं दर्ज नहीं होता। दस्तावेज़ को PDF में निर्यात करते ही वह बनावट फेंक दी जाती है।
इसलिए कॉपी सुविधा बस दिखने के क्रम में अक्षरों को जोड़ती जाती है। एक ख़ाने और दूसरे के बीच का अंतर न टैब है न अल्पविराम, सिर्फ़ निर्देशांकों का फ़र्क़ है, तो पेस्ट करने वाले के पास बाँटने का कोई आधार नहीं बचता।
यही एक बात बाक़ी सब समझा देती है। तालिका दोबारा बनाने के लिए लकीरें या टैग नहीं, मानों की जगह देखनी पड़ती है, और जगह देखना हमेशा अनुमान ही होता है।
अंक लेख बनकर आने की समस्या
ख़ाने ठीक बँट जाने पर भी Excel अक्सर उन मानों को अंक नहीं मानता। PDF यह दर्ज नहीं करता कि कोई मान अंक है या नाम, इसलिए वह जैसा दिखता है वैसा ही चला आता है। ज़्यादातर मामले Excel में दो-चार क़दम में सुलझ जाते हैं।
| अगर ऐसे आया है | कारण और समाधान |
|---|---|
| 1,204 बाईं ओर सटा हुआ | हज़ार का विभाजक होने से Excel इसे लेख मानता है। कोष्ठ का प्रारूप संख्या कर दीजिए, या खोजें-बदलें से अल्पविराम हटा दीजिए |
| ₹18,40,000 जुड़ता नहीं | आगे मुद्रा चिह्न लगा है। चिह्न हटाइए और कोष्ठ का प्रारूप मुद्रा कर दीजिए |
| (1,204) ऋणात्मक नहीं माना जा रहा | यह लेखा शैली का कोष्ठक वाला ऋण है। Excel न पहचाने तो कोष्ठक हटाकर आगे ऋण चिह्न लगाइए |
| 38% का मतलब 0.38 नहीं निकल रहा | यह प्रतिशत चिह्न लगा लेख है। चिह्न हटाइए और कोष्ठ का प्रारूप प्रतिशत कर दीजिए |
| 1204 जैसे असामान्य चौड़े अंक | पूर्ण-चौड़ाई के अंक, पूर्वी एशिया के दस्तावेज़ों में मिलते हैं। सूत्र से आधी चौड़ाई में बदलिए |
| क्रमांक तारीख़ बन गया | उल्टा मामला: Excel ने जल्दबाज़ी में तारीख़ मान लिया। पेस्ट करने से पहले स्तंभ का प्रारूप लेख कर दीजिए |
जब कोष्ठ एक स्तंभ खिसक जाएँ
ख़ाली कोष्ठ इसकी जड़ हैं। ख़ाली कोष्ठ PDF में कोई निशान छोड़ता ही नहीं: अक्षर नहीं हैं तो छापने का निर्देश भी नहीं है। इसलिए उस क़तार में एक कोष्ठ कम दिखता है और उसके बाद सब कुछ एक खाना आगे खिसक जाता है।
औज़ार हर मान को सबसे नज़दीकी स्तंभ में गिराकर इस दिक़्क़त को घटाता है, पर बहुत सँकरे स्तंभों वाली तालिकाएँ फिर भी बेमेल हो सकती हैं। जुड़े हुए कोष्ठ भी ऐसे ही हैं: आपकी आँख दो कोष्ठों को मिला हुआ देखती है, जबकि फ़ाइल में एक लेख-टुकड़ा पड़ोसियों से थोड़ा बाईं ओर बैठा होता है।
कौन से PDF अच्छे नतीजे देते हैं
मूल कैसे बना था, यही नतीजा तय करता है।
- अच्छे नतीजे। Excel या Word में तालिका बनाकर PDF में निर्यात किया दस्तावेज़। स्तंभ सीधे खड़े होते हैं, इसलिए सिर्फ़ जगह देखकर कोष्ठ बँट जाते हैं।
- मिले-जुले। प्रकाशन सॉफ़्टवेयर से सजाई रिपोर्टें, जहाँ बीच में जमाना और हाशिया मिलकर स्तंभ का बायाँ किनारा डगमगा देते हैं।
- नहीं चलते। स्कैन किया PDF। हर पन्ना तस्वीर है और निकालने को अक्षर हैं ही नहीं। यह औज़ार की कमी नहीं है।
- ध्यान रखें। कई पन्नों में फैली लंबी तालिका। हर पन्ने पर शीर्षक दोहराया जाता है, इसलिए बदलने के बाद दोहराई गई शीर्षक पंक्तियाँ मिटा दीजिए।
लाने के बाद अंकों की जाँच हमेशा करें
तालिका लाने के काम में अनुमान मिला होता है, यानी वह चुपचाप बिगड़ सकता है। एक मान ग़ायब हो या एक स्तंभ खिसक जाए, स्क्रीन पर सब फिर भी करीने का दिखता है।
अगर मूल में जोड़ की पंक्ति है तो वही सबसे अच्छी जाँच है। Excel में वही स्तंभ जोड़िए और छपे हुए जोड़ से मिलाइए। जोड़ की पंक्ति न हो तो कम से कम पंक्तियाँ और स्तंभ गिन लीजिए। यह एक जाँच ग़लत अंकों पर रिपोर्ट लिखने से कहीं सस्ती पड़ती है।
अक्सर पूछे जाने वाले प्रश्न
- सिर्फ़ तालिका ही सही-सही निकालने का कोई तरीक़ा है?
- बदलने से पहले PDF को उन्हीं पन्नों तक काट लीजिए जिनमें तालिका है, नतीजा साफ़ आएगा। मुख्य लेख के अनुच्छेद मिले होने पर औज़ार को यह तय करने में ज़्यादा मशक़्क़त होती है कि तालिका कहाँ से शुरू हुई।
- मेरे सारे अंक लेख बनकर आए।
- PDF यह दर्ज नहीं करता कि मान अंक है या नाम, इसलिए वह जैसा दिखता है वैसा ही रखा जाता है। Excel में वह स्तंभ चुनकर Data टैब से एक बार Text to Columns चलाइए, आम तौर पर सब एक साथ अंकों में बदल जाते हैं।
- जुड़े हुए कोष्ठों वाली तालिका का क्या?
- जुड़े कोष्ठ साथ नहीं आते। जुड़े हिस्से का मान सबसे नज़दीकी एक स्तंभ में जाता है। बाद में Excel में दोबारा जोड़ लेना तेज़ पड़ता है।
- कई पन्नों में फैली तालिका का क्या?
- हर पन्ना अपनी शीट बनता है। जोड़ना हो तो एक शीट को दूसरी के नीचे चिपकाइए और दोहराई गई शीर्षक पंक्तियाँ मिटा दीजिए।
- स्कैन किए PDF का सचमुच कोई रास्ता नहीं?
- अक्षर निकालने के रास्ते से नहीं। स्कैन पन्ने की तस्वीर है और उसमें अक्षर नहीं होते। जारी करने वाले से मूल फ़ाइल माँगना आम तौर पर तेज़ है।
अपडेट 17 सितंबर 2026