PDF से Excel में टेबल कैसे निकालें
संक्षेप में: PDF की तालिकाएँ Excel में लाने के लिए pdf-to-excel खोलिए और पहचान को ऑटो पर रहने दीजिए। कार्यपुस्तिका में विषय-सूची शीट, पाठ शीट, हर पृष्ठ की छवि और हर मिली तालिका के लिए असली खानों वाली अलग शीट होगी।
क्लस्टर
चरण-दर-चरण मार्गदर्शिका
इनपुट से भरोसेमंद परिणाम तक PDF कार्य ले जाने के लिए चरण-दर-चरण निर्देश.
मुख्य टूल
PDF से Excel ऑनलाइन
इस लेख वाला टूल खोलें और मौजूदा लोकैल में ऑपरेशन पूरा करें.
टूल खोलेंविषय-सूची
PDF की तालिकाएँ Excel में कैसे लाएँ
रिपोर्ट में एक तालिका है, और उसे दोबारा टाइप करने के बजाय नए सिरे से जोड़ना है। औज़ार इसके लिए उससे अधिक करता है जितना नाम से लगता है: वह केवल पाठ उलट नहीं देता, बल्कि अलग-अलग काम की कई शीटों वाली कार्यपुस्तिका बनाता है। पहली बार चलाने से पहले उसका ढाँचा समझ लेना फ़ायदे का सौदा है।
डाउनलोड की गई फ़ाइल में असल में क्या है
परिणाम आँकड़ों की एक शीट नहीं है। वह ऐसी कार्यपुस्तिका है जिसकी शीटें अलग-अलग भूमिकाएँ निभाती हैं।
| शीट | उस पर क्या है |
|---|---|
| विषय-सूची | पृष्ठों की अनुक्रमणिका, बाक़ी शीटों की कड़ियों के साथ |
| पाठ | दस्तावेज़ का पाठ, हर पृष्ठ की एक पंक्ति |
| पृष्ठ N | PDF के पूरे पृष्ठ की छवि |
| तालिका N.M | पहचानी गई तालिका असली खानों में |
सारा खेल आख़िरी पंक्ति के लिए है। तालिका वाली शीटों में वे आँकड़े होते हैं जिन पर सूत्र लगाए जा सकते हैं। पृष्ठों की छवियाँ और पाठ शीट उस स्थिति के लिए बीमा हैं जब कोई तालिका पहचानी न जाए: सामग्री तब भी आँखों के सामने रहती है।
विषय-सूची शीट अनुक्रमणिका की तरह काम करती है: पृष्ठ संख्या, उस पृष्ठ की शीट की कड़ी और दिशा पाने के लिए उसके पाठ की पहली पंक्ति। कड़ियाँ कार्यपुस्तिका के भीतर ही ले जाती हैं।
पहचान के तीन ढंग
पहचान का पैरामीटर बदलता है कि औज़ार खानों की सीमाएँ किस तरह ढूँढ़े, और यही परिणाम को बाक़ी सब से अधिक बदलता है।
| ढंग | तालिका कैसे ढूँढ़ता है | कार्यपुस्तिका में क्या रहता है |
|---|---|---|
| ऑटो | जाली की रेखाओं से | सभी शीटें, पाठ वाली सहित |
| कठोर | रेखाओं से, उनके कटान पर कड़ी शर्तों के साथ | पाठ शीट बनती ही नहीं |
| लचीला | पाठ की अपनी स्थिति से, रेखाओं के सहारे बिना | सभी शीटें, और पृष्ठ का पूरा पाठ खाने की टिप्पणी में |
पहले से ऑटो चुना रहता है। कठोर ढंग उससे केवल रेखाओं की नुक्ताचीनी में अलग नहीं है: वह कार्यपुस्तिका से पाठ शीट हटा देता है और केवल तालिकाएँ तथा छवियाँ छोड़ता है। यह तब सार्थक है जब परिणाम आगे की प्रक्रिया में जाना हो और फ़ालतू शीटें बाधा बनें।
लचीला अकेला ढंग है जो बिना रेखाओं वाली तालिकाएँ देख पाता है। इसकी क़ीमत चुकानी पड़ती है, और वह ऊँची है।
उसका एक पार्श्व प्रभाव भी है, जो कभी-कभी उसके मुख्य काम से अधिक उपयोगी निकलता है: लचीले ढंग में पृष्ठ का पूरा पाठ छवि वाली शीट के पहले खाने की टिप्पणी में भी चला जाता है। कर्सर ले जाकर पृष्ठ की सामग्री पाठ शीट पर गए बिना पढ़ी जा सकती है।
नाप ने क्या दिखाया
लिया गया ऐसा दस्तावेज़ जिसके पहले पृष्ठ पर दो तालिकाएँ हैं: एक रेखाओं वाली और दूसरी बिना किसी रेखा के, केवल सीध में लगे स्तंभ।
ऑटो और कठोर ने केवल पहली को पाया और उसे बेदाग़ उतारा: तीन पंक्तियाँ, तीन स्तंभ, मान अपनी जगह।
लचीले ने दोनों पाईं, पर उन्हें एक ही जाली में समेट दिया और साथ ही शब्दों को स्तंभों के बीच तोड़ डाला। शब्द «Region» दो खानों में बँट गया, «Re» और «gion»। «North» «No» और «rth» हो गया। संख्या 900 «9» और «00» में बिखर गई। आँकड़ों की पंक्तियों के बीच ख़ाली पंक्तियाँ आ गईं।
व्यावहारिक निष्कर्ष: शुरुआत ऑटो से कीजिए। यदि कोई तालिका न मिले और दस्तावेज़ में सचमुच रेखाएँ न हों, तो लचीले पर जाइए, पर हाथ से जोड़ने के लिए समय रखिए। वह सामग्री देता है, तैयार परिणाम नहीं।
और उलटा भी: यदि PDF में तालिका रेखाओं सहित बनी है और परिणाम फिर भी ख़ाली है, तो दोष ढंग का नहीं। सबसे संभव यह कि दस्तावेज़ में पाठ परत ही नहीं।
तालिका कैसे लाएँ
1. pdf-to-excel खोलिए और दस्तावेज़ चढ़ाइए। 2. पहली कोशिश के लिए पहचान को ऑटो पर ही रहने दीजिए। 3. प्रसंस्करण चलाइए और कार्यपुस्तिका डाउनलोड कीजिए। 4. विषय-सूची शीट खोलिए और तालिका वाली शीटों पर जाइए। 5. दो-तीन पंक्तियों की संख्याएँ बगल वाली शीट पर पड़ी पृष्ठ छवि से मिलाइए। 6. यदि कोई तालिका न निकली हो, तो लचीले ढंग में दोहराइए।
पाँचवाँ बिंदु ठीक इसीलिए है कि पृष्ठ की छवि उसी कार्यपुस्तिका में पड़ी है। उतरे हुए को मूल से मिलाने के लिए Excel छोड़ना कभी नहीं पड़ता।
मिले हुए खाने और छँटाई
खानों को मिलाने वाला स्विच पहले से चालू रहता है। वह उन खानों से जुड़ा है जो मूल तालिका में कई स्तंभों तक फैले थे: चालू होने पर वह उन्हें असली मिले हुए क्षेत्रों के रूप में लौटा देता है और मूल की शक्ल दोहराता है।
बंद होने पर वह ऐसे खानों को साधारण खानों में तोड़ देता है: मान पहले में रहता है, बाक़ी ख़ाली हो जाते हैं।
चुनाव इस बात से कीजिए कि आँकड़ों के साथ आगे क्या करना है।
यदि तालिका पढ़ी और छापी जाएगी, तो मिलाना चालू रहने दीजिए: परिणाम मूल से मेल खाएगा।
यदि आँकड़ों पर छँटाई, छानना या पिवट बनाना है, तो बंद कर दीजिए। Excel मिले हुए खानों वाले क्षेत्र को छाँटने से इनकार करता है और माँगता है कि सबका आकार एक हो। बाद में हाथ से मिलान तोड़ने में स्विच पहले हटाने से अधिक समय लगता है।
फ़ाइल उम्मीद से भारी क्यों निकलती है
PDF का हर पृष्ठ कार्यपुस्तिका में अपनी अलग शीट बनकर आता है, जिस पर पूरे आकार की छवि होती है, लगभग दुगुने रिज़ॉल्यूशन पर बनी। परिणाम का लगभग सारा वज़न यही छवियाँ बनाती हैं।
छोटे परीक्षण दस्तावेज़ पर अंतर ख़ास तौर पर दिखता है: मूल PDF का वज़न 2 KB था, कार्यपुस्तिका लगभग 45 KB निकली। असली रिपोर्टों में हिसाब मेगाबाइट में जाता है, और वह पृष्ठों की संख्या से बढ़ता है, तालिकाओं की संख्या से नहीं।
यदि केवल आँकड़े चाहिए और छवियाँ बाधा हैं, तो फ़ालतू शीटें Excel में दो क्रियाओं में मिटाई जा सकती हैं, और सहेजने पर फ़ाइल हल्की हो जाती है।
स्कैन और बिना पाठ परत वाली तालिका
औज़ार पाठ पढ़ता है, पहचानता नहीं। स्कैन की गई तालिका उसके लिए छवि है: पृष्ठ की छवि कार्यपुस्तिका में रहेगी, पाठ शीट ख़ाली निकलेगी, और किसी भी ढंग में तालिका नहीं मिलेगी।
इलाज रूपांतरण से पहले है: फ़ाइल को ocr-pdf से गुज़ारिए, पाठ परत पाइए और उसके बाद तालिका में बदलिए। उलटा क्रम बेकार है, क्योंकि Excel के पास पहचानने को कुछ बचेगा ही नहीं।
यही तरक़ीब उन दस्तावेज़ों में भी काम आती है जिनका पाठ है तो सही, पर टेढ़ा है: कोण से ली गई पृष्ठ सीधी पृष्ठ से बुरी पहचानी जाती है, और पहचान से पहले उसे सीधा करना परिणाम को साफ़ तौर पर बदल देता है।
सीमाएँ, चेतावनियाँ और पड़ोसी औज़ार
यदि किसी पृष्ठ पर तालिका की पहचान विफल हो जाए, तो काम गिरता नहीं। कार्यपुस्तिका पूरी आती है और उत्तर में उन पृष्ठों की संख्या बताती चेतावनी जुड़ जाती है: वहाँ से तालिकाएँ नहीं आएँगी, छवि और पाठ बने रहेंगे। यही उन पृष्ठों पर लागू है जिनका पाठ पढ़ा नहीं जा सका।
खोलने के पासवर्ड वाला दस्तावेज़ संसाधित नहीं होता; सुरक्षा unlock-pdf से हटाइए। जो पासवर्ड केवल छपाई या नक़ल रोकता है, वह तालिकाएँ निकालने में बाधा नहीं डालता।
जब एक पृष्ठ पर कई तालिकाएँ हों, तो हर एक को अपनी शीट मिलती है, जिसका नाम पृष्ठ संख्या और उस पृष्ठ पर तालिका के क्रम से बनता है। Excel में शीट के नाम की लंबाई सीमित है, इसलिए लंबे नाम काट दिए जाते हैं और एक जैसे नाम अंकों के प्रत्यय से अलग किए जाते हैं।
यदि दस्तावेज़ से आपको तालिकाएँ नहीं, बल्कि संपादन योग्य पाठ चाहिए, तो वह सतत ढंग में pdf-to-word है: वहाँ यही पहचानकर्ता उन्हें असली Word तालिकाओं के रूप में उतारता है। और तैयार कार्यपुस्तिका को वापस PDF बनाना excel-to-pdf का काम है।
FAQ
इस क्लस्टर से और
चरण-दर-चरण मार्गदर्शिका
PDF को एडिट करने योग्य Word में बदलें
फ़ाइल Word में खुल गई पर कर्सर पाठ में नहीं घुसता? पहले से चुनी सेटिंग छवि क्यों देती है, सतत ढंग «एकदम सही» से कैसे अलग है, और शीर्ष-पाद कहाँ चले गए।
चरण-दर-चरण मार्गदर्शिका
PDF से चुनिंदा पेज अलग फाइल में लें
PDF से ज़रूरी पन्ने अलग फ़ाइल के रूप में निकालना: दोनों आउटपुट ढंग किस तरह अलग हैं, संग्रह की फ़ाइलें मूल पृष्ठ संख्याएँ क्यों सँभाले रखती हैं, और आकार सुरक्षित रखना बंद करने से क्या होता है।
चरण-दर-चरण मार्गदर्शिका
PDF पेज के मार्जिन और कचरा क्रॉप करें
कटाई सिर्फ़ पेज का दिखने वाला हिस्सा बदलती है, जबकि उसके बाहर की सामग्री फ़ाइल में बनी रहती है। व्यवहार में इसका क्या अर्थ है, मार्जिन पूरे दस्तावेज़ पर क्यों लगते हैं, और घुमाई गई पेज पर कटाई कैसे बरतती है।
संबंधित टूल
PDF से Excel ऑनलाइन
PDF के table डेटा को Excel में निकालें ताकि गणना, filter और sort किया जा सके.
Excel से PDF ऑनलाइन
Excel sheet को PDF में बदलें ताकि उसका रूप तय रहे और आसानी से print या भेजी जा सके.
ओसीआर पीडीएफ ऑनलाइन
ओसीआर पीडीएफ PDF कार्य को एक ही ब्राउज़र प्रवाह में रखता है: स्रोत फ़ाइल अपलोड करें, विकल्प देखें, प्रक्रिया चलाएँ और परिणाम डाउनलोड करें.
PDF से Word ऑनलाइन
PDF को Word document में बदलें ताकि text संपादित करें, sections बढ़ाएँ और बदलाव करें.
आगे क्या करें
सभी टूल्स
PDF tools catalog: PDF merge, compress, split, convert, rotate, protect और unlock करें, सब कुछ सीधे आपके browser में.
अक्सर पूछे जाने वाले प्रश्न
iHatePDF के बारे में frequently asked questions के जवाब: क्या registration जरूरी है, files कैसे process होती हैं, limits कहाँ देखें और documents upload करना safe है या नहीं।
संपर्क
Processing errors, tool चुनने, safety, business queries और नए features के सुझावों के लिए iHatePDF से संपर्क करें।