मुख्य सामग्री पर जाएं
लेख

PDF से Excel में टेबल कैसे निकालें

PDF से Excel: डाउनलोड की गई कार्यपुस्तिका में कौन-सी शीटें आती हैं, पहचान के तीन ढंग व्यवहार में कैसे अलग हैं, और लचीला ढंग अधिक तालिकाएँ पाकर भी शब्द क्यों तोड़ देता है।

संक्षेप में: PDF की तालिकाएँ Excel में लाने के लिए pdf-to-excel खोलिए और पहचान को ऑटो पर रहने दीजिए। कार्यपुस्तिका में विषय-सूची शीट, पाठ शीट, हर पृष्ठ की छवि और हर मिली तालिका के लिए असली खानों वाली अलग शीट होगी।

क्लस्टर

चरण-दर-चरण मार्गदर्शिका

इनपुट से भरोसेमंद परिणाम तक PDF कार्य ले जाने के लिए चरण-दर-चरण निर्देश.

13 लेख

मुख्य टूल

PDF से Excel ऑनलाइन

इस लेख वाला टूल खोलें और मौजूदा लोकैल में ऑपरेशन पूरा करें.

टूल खोलें

विषय-सूची

PDF की तालिकाएँ Excel में कैसे लाएँ

रिपोर्ट में एक तालिका है, और उसे दोबारा टाइप करने के बजाय नए सिरे से जोड़ना है। औज़ार इसके लिए उससे अधिक करता है जितना नाम से लगता है: वह केवल पाठ उलट नहीं देता, बल्कि अलग-अलग काम की कई शीटों वाली कार्यपुस्तिका बनाता है। पहली बार चलाने से पहले उसका ढाँचा समझ लेना फ़ायदे का सौदा है।

डाउनलोड की गई फ़ाइल में असल में क्या है

परिणाम आँकड़ों की एक शीट नहीं है। वह ऐसी कार्यपुस्तिका है जिसकी शीटें अलग-अलग भूमिकाएँ निभाती हैं।

शीटउस पर क्या है
विषय-सूचीपृष्ठों की अनुक्रमणिका, बाक़ी शीटों की कड़ियों के साथ
पाठदस्तावेज़ का पाठ, हर पृष्ठ की एक पंक्ति
पृष्ठ NPDF के पूरे पृष्ठ की छवि
तालिका N.Mपहचानी गई तालिका असली खानों में

सारा खेल आख़िरी पंक्ति के लिए है। तालिका वाली शीटों में वे आँकड़े होते हैं जिन पर सूत्र लगाए जा सकते हैं। पृष्ठों की छवियाँ और पाठ शीट उस स्थिति के लिए बीमा हैं जब कोई तालिका पहचानी न जाए: सामग्री तब भी आँखों के सामने रहती है।

विषय-सूची शीट अनुक्रमणिका की तरह काम करती है: पृष्ठ संख्या, उस पृष्ठ की शीट की कड़ी और दिशा पाने के लिए उसके पाठ की पहली पंक्ति। कड़ियाँ कार्यपुस्तिका के भीतर ही ले जाती हैं।

पहचान के तीन ढंग

पहचान का पैरामीटर बदलता है कि औज़ार खानों की सीमाएँ किस तरह ढूँढ़े, और यही परिणाम को बाक़ी सब से अधिक बदलता है।

ढंगतालिका कैसे ढूँढ़ता हैकार्यपुस्तिका में क्या रहता है
ऑटोजाली की रेखाओं सेसभी शीटें, पाठ वाली सहित
कठोररेखाओं से, उनके कटान पर कड़ी शर्तों के साथपाठ शीट बनती ही नहीं
लचीलापाठ की अपनी स्थिति से, रेखाओं के सहारे बिनासभी शीटें, और पृष्ठ का पूरा पाठ खाने की टिप्पणी में

पहले से ऑटो चुना रहता है। कठोर ढंग उससे केवल रेखाओं की नुक्ताचीनी में अलग नहीं है: वह कार्यपुस्तिका से पाठ शीट हटा देता है और केवल तालिकाएँ तथा छवियाँ छोड़ता है। यह तब सार्थक है जब परिणाम आगे की प्रक्रिया में जाना हो और फ़ालतू शीटें बाधा बनें।

लचीला अकेला ढंग है जो बिना रेखाओं वाली तालिकाएँ देख पाता है। इसकी क़ीमत चुकानी पड़ती है, और वह ऊँची है।

उसका एक पार्श्व प्रभाव भी है, जो कभी-कभी उसके मुख्य काम से अधिक उपयोगी निकलता है: लचीले ढंग में पृष्ठ का पूरा पाठ छवि वाली शीट के पहले खाने की टिप्पणी में भी चला जाता है। कर्सर ले जाकर पृष्ठ की सामग्री पाठ शीट पर गए बिना पढ़ी जा सकती है।

नाप ने क्या दिखाया

लिया गया ऐसा दस्तावेज़ जिसके पहले पृष्ठ पर दो तालिकाएँ हैं: एक रेखाओं वाली और दूसरी बिना किसी रेखा के, केवल सीध में लगे स्तंभ।

ऑटो और कठोर ने केवल पहली को पाया और उसे बेदाग़ उतारा: तीन पंक्तियाँ, तीन स्तंभ, मान अपनी जगह।

लचीले ने दोनों पाईं, पर उन्हें एक ही जाली में समेट दिया और साथ ही शब्दों को स्तंभों के बीच तोड़ डाला। शब्द «Region» दो खानों में बँट गया, «Re» और «gion»। «North» «No» और «rth» हो गया। संख्या 900 «9» और «00» में बिखर गई। आँकड़ों की पंक्तियों के बीच ख़ाली पंक्तियाँ आ गईं।

व्यावहारिक निष्कर्ष: शुरुआत ऑटो से कीजिए। यदि कोई तालिका न मिले और दस्तावेज़ में सचमुच रेखाएँ न हों, तो लचीले पर जाइए, पर हाथ से जोड़ने के लिए समय रखिए। वह सामग्री देता है, तैयार परिणाम नहीं।

और उलटा भी: यदि PDF में तालिका रेखाओं सहित बनी है और परिणाम फिर भी ख़ाली है, तो दोष ढंग का नहीं। सबसे संभव यह कि दस्तावेज़ में पाठ परत ही नहीं।

तालिका कैसे लाएँ

1. pdf-to-excel खोलिए और दस्तावेज़ चढ़ाइए। 2. पहली कोशिश के लिए पहचान को ऑटो पर ही रहने दीजिए। 3. प्रसंस्करण चलाइए और कार्यपुस्तिका डाउनलोड कीजिए। 4. विषय-सूची शीट खोलिए और तालिका वाली शीटों पर जाइए। 5. दो-तीन पंक्तियों की संख्याएँ बगल वाली शीट पर पड़ी पृष्ठ छवि से मिलाइए। 6. यदि कोई तालिका न निकली हो, तो लचीले ढंग में दोहराइए।

पाँचवाँ बिंदु ठीक इसीलिए है कि पृष्ठ की छवि उसी कार्यपुस्तिका में पड़ी है। उतरे हुए को मूल से मिलाने के लिए Excel छोड़ना कभी नहीं पड़ता।

मिले हुए खाने और छँटाई

खानों को मिलाने वाला स्विच पहले से चालू रहता है। वह उन खानों से जुड़ा है जो मूल तालिका में कई स्तंभों तक फैले थे: चालू होने पर वह उन्हें असली मिले हुए क्षेत्रों के रूप में लौटा देता है और मूल की शक्ल दोहराता है।

बंद होने पर वह ऐसे खानों को साधारण खानों में तोड़ देता है: मान पहले में रहता है, बाक़ी ख़ाली हो जाते हैं।

चुनाव इस बात से कीजिए कि आँकड़ों के साथ आगे क्या करना है।

यदि तालिका पढ़ी और छापी जाएगी, तो मिलाना चालू रहने दीजिए: परिणाम मूल से मेल खाएगा।

यदि आँकड़ों पर छँटाई, छानना या पिवट बनाना है, तो बंद कर दीजिए। Excel मिले हुए खानों वाले क्षेत्र को छाँटने से इनकार करता है और माँगता है कि सबका आकार एक हो। बाद में हाथ से मिलान तोड़ने में स्विच पहले हटाने से अधिक समय लगता है।

फ़ाइल उम्मीद से भारी क्यों निकलती है

PDF का हर पृष्ठ कार्यपुस्तिका में अपनी अलग शीट बनकर आता है, जिस पर पूरे आकार की छवि होती है, लगभग दुगुने रिज़ॉल्यूशन पर बनी। परिणाम का लगभग सारा वज़न यही छवियाँ बनाती हैं।

छोटे परीक्षण दस्तावेज़ पर अंतर ख़ास तौर पर दिखता है: मूल PDF का वज़न 2 KB था, कार्यपुस्तिका लगभग 45 KB निकली। असली रिपोर्टों में हिसाब मेगाबाइट में जाता है, और वह पृष्ठों की संख्या से बढ़ता है, तालिकाओं की संख्या से नहीं।

यदि केवल आँकड़े चाहिए और छवियाँ बाधा हैं, तो फ़ालतू शीटें Excel में दो क्रियाओं में मिटाई जा सकती हैं, और सहेजने पर फ़ाइल हल्की हो जाती है।

स्कैन और बिना पाठ परत वाली तालिका

औज़ार पाठ पढ़ता है, पहचानता नहीं। स्कैन की गई तालिका उसके लिए छवि है: पृष्ठ की छवि कार्यपुस्तिका में रहेगी, पाठ शीट ख़ाली निकलेगी, और किसी भी ढंग में तालिका नहीं मिलेगी।

इलाज रूपांतरण से पहले है: फ़ाइल को ocr-pdf से गुज़ारिए, पाठ परत पाइए और उसके बाद तालिका में बदलिए। उलटा क्रम बेकार है, क्योंकि Excel के पास पहचानने को कुछ बचेगा ही नहीं।

यही तरक़ीब उन दस्तावेज़ों में भी काम आती है जिनका पाठ है तो सही, पर टेढ़ा है: कोण से ली गई पृष्ठ सीधी पृष्ठ से बुरी पहचानी जाती है, और पहचान से पहले उसे सीधा करना परिणाम को साफ़ तौर पर बदल देता है।

सीमाएँ, चेतावनियाँ और पड़ोसी औज़ार

यदि किसी पृष्ठ पर तालिका की पहचान विफल हो जाए, तो काम गिरता नहीं। कार्यपुस्तिका पूरी आती है और उत्तर में उन पृष्ठों की संख्या बताती चेतावनी जुड़ जाती है: वहाँ से तालिकाएँ नहीं आएँगी, छवि और पाठ बने रहेंगे। यही उन पृष्ठों पर लागू है जिनका पाठ पढ़ा नहीं जा सका।

खोलने के पासवर्ड वाला दस्तावेज़ संसाधित नहीं होता; सुरक्षा unlock-pdf से हटाइए। जो पासवर्ड केवल छपाई या नक़ल रोकता है, वह तालिकाएँ निकालने में बाधा नहीं डालता।

जब एक पृष्ठ पर कई तालिकाएँ हों, तो हर एक को अपनी शीट मिलती है, जिसका नाम पृष्ठ संख्या और उस पृष्ठ पर तालिका के क्रम से बनता है। Excel में शीट के नाम की लंबाई सीमित है, इसलिए लंबे नाम काट दिए जाते हैं और एक जैसे नाम अंकों के प्रत्यय से अलग किए जाते हैं।

यदि दस्तावेज़ से आपको तालिकाएँ नहीं, बल्कि संपादन योग्य पाठ चाहिए, तो वह सतत ढंग में pdf-to-word है: वहाँ यही पहचानकर्ता उन्हें असली Word तालिकाओं के रूप में उतारता है। और तैयार कार्यपुस्तिका को वापस PDF बनाना excel-to-pdf का काम है।

FAQ

पहले देखिए कि तालिका में रेखाएँ हैं या नहीं: ऑटो और कठोर ढंग खानों की सीमाएँ रेखाओं के सहारे ढूँढ़ते हैं। बिना रेखाओं वाली तालिका केवल लचीला ढंग देखता है। रेखाएँ हों और परिणाम फिर भी ख़ाली रहे, तो सबसे संभव यह कि पाठ परत नहीं है और OCR चाहिए।
वह रेखाओं के बजाय पाठ की स्थिति पर टिकता है, और नाप में उसने शब्दों को स्तंभों के बीच तोड़ दिया: Region «Re» और «gion» बन गया, संख्या 900 «9» और «00» में बँट गई। वह हाथ से जोड़ने की सामग्री देता है, तैयार तालिका नहीं।
मिले हुए खानों की वजह से: मिलाने वाला स्विच पहले से चालू रहता है और कई स्तंभों तक फैले खानों को लौटा देता है। यदि आँकड़ों पर छँटाई या पिवट करनी है, तो प्रसंस्करण से पहले उसे बंद कर दीजिए।
PDF का हर पृष्ठ उसमें अपनी अलग शीट बनकर आता है, पूरे आकार की छवि के साथ। लगभग सारा वज़न यही छवियाँ बनाती हैं। यदि केवल आँकड़े चाहिए, तो फ़ालतू शीटें Excel में मिटाई जा सकती हैं और सहेजने पर फ़ाइल हल्की हो जाती है।
फ़ाइलें केवल चुने गए ऑपरेशन के लिए उपयोग की जाती हैं और प्रसंस्करण पूरा होने के बाद स्वतः हटा दी जाती हैं। हम अपलोड किए गए दस्तावेज़ों का उपयोग AI मॉडल के प्रशिक्षण के लिए नहीं करते।

इस क्लस्टर से और

चरण-दर-चरण मार्गदर्शिका

PDF को एडिट करने योग्य Word में बदलें

फ़ाइल Word में खुल गई पर कर्सर पाठ में नहीं घुसता? पहले से चुनी सेटिंग छवि क्यों देती है, सतत ढंग «एकदम सही» से कैसे अलग है, और शीर्ष-पाद कहाँ चले गए।

चरण-दर-चरण मार्गदर्शिका

PDF से चुनिंदा पेज अलग फाइल में लें

PDF से ज़रूरी पन्ने अलग फ़ाइल के रूप में निकालना: दोनों आउटपुट ढंग किस तरह अलग हैं, संग्रह की फ़ाइलें मूल पृष्ठ संख्याएँ क्यों सँभाले रखती हैं, और आकार सुरक्षित रखना बंद करने से क्या होता है।

चरण-दर-चरण मार्गदर्शिका

PDF पेज के मार्जिन और कचरा क्रॉप करें

कटाई सिर्फ़ पेज का दिखने वाला हिस्सा बदलती है, जबकि उसके बाहर की सामग्री फ़ाइल में बनी रहती है। व्यवहार में इसका क्या अर्थ है, मार्जिन पूरे दस्तावेज़ पर क्यों लगते हैं, और घुमाई गई पेज पर कटाई कैसे बरतती है।

संबंधित टूल

← रूपांतरण श्रेणी के सभी टूल

आगे क्या करें

अगर पढ़ने के बाद आपको अगला व्यावहारिक कदम या सेवा के बारे में और मार्गदर्शन चाहिए, तो ये पेज खोलें.

सभी टूल्स

PDF tools catalog: PDF merge, compress, split, convert, rotate, protect और unlock करें, सब कुछ सीधे आपके browser में.

अक्सर पूछे जाने वाले प्रश्न

iHatePDF के बारे में frequently asked questions के जवाब: क्या registration जरूरी है, files कैसे process होती हैं, limits कहाँ देखें और documents upload करना safe है या नहीं।

संपर्क

Processing errors, tool चुनने, safety, business queries और नए features के सुझावों के लिए iHatePDF से संपर्क करें।