PDF को एडिट करने योग्य Word में बदलें
संक्षेप में: सचमुच संपादन योग्य Word पाने के लिए pdf-to-word में परिणाम का प्रकार «सतत» कर दीजिए: पहले से «एकदम सही» लगा रहता है, जो हर पृष्ठ को खोज के लिए छिपी परत सहित छवि बनाकर डालता है। सतत ढंग अनुच्छेद, शीर्षक और असली Word तालिकाएँ बनाता है।
क्लस्टर
चरण-दर-चरण मार्गदर्शिका
इनपुट से भरोसेमंद परिणाम तक PDF कार्य ले जाने के लिए चरण-दर-चरण निर्देश.
मुख्य टूल
PDF से Word ऑनलाइन
इस लेख वाला टूल खोलें और मौजूदा लोकैल में ऑपरेशन पूरा करें.
टूल खोलेंविषय-सूची
PDF को संपादन योग्य Word में कैसे बदलें
माँग लगभग हमेशा एक ही होती है: भेजे गए PDF में दो अनुच्छेद सुधारने हैं। और पहली कोशिश लगभग हमेशा निराश करती है। फ़ाइल Word में खुलती है, दिखने में एकदम ठीक, पर कर्सर पाठ में घुसता ही नहीं। यह रूपांतरण की गड़बड़ी नहीं, बल्कि उस सेटिंग का नतीजा है जो पहले से लगी रहती है।
पहले से चुनी सेटिंग में छवि मिलती है, पाठ नहीं
औज़ार के दो ढंग हैं, और उनके बीच का चयन «परिणाम का प्रकार» कहलाता है। पहले से «एकदम सही» चुना रहता है, और वह वही करता है जिसका वादा है: पृष्ठ की शक्ल अक्षरशः बचा लेता है। तरीका इसमें बेरहम है: PDF का हर पृष्ठ छवि के रूप में बनाया जाता है और पूरा का पूरा Word दस्तावेज़ में चिपका दिया जाता है।
इसी से बदल दिए जाने का एहसास होता है। यह .docx है, Word में खुलता है, पृष्ठ मूल से आकार और दिशा में मेल खाते हैं, और संपादन के लिए कुछ है ही नहीं: पृष्ठ पर छवियाँ पड़ी हैं।
दूसरा ढंग, सतत, पृष्ठ को टुकड़ों में खोलता है और उनसे असली Word दस्तावेज़ बनाता है: अनुच्छेद, शीर्षक, सूचियाँ और तालिकाएँ। बदले में पृष्ठ पर तत्वों की ठीक-ठीक जगह चली जाती है।
| ढंग | भीतर क्या है | क्या किया जा सकता है |
|---|---|---|
| एकदम सही | हर पृष्ठ की छवि और उसके नीचे छिपी पाठ परत | पढ़ना, पाठ में खोजना, छापना |
| सतत | Word के अनुच्छेद, शीर्षक, सूचियाँ और तालिकाएँ | पाठ बदलना, शैलियाँ बदलना, तालिकाओं पर काम करना |
चुनाव गुणवत्ता का नहीं, काम का है। जिस दस्तावेज़ को परिचित दफ़्तरी रूप में आगे भेजना है और छूना नहीं, उसके लिए «एकदम सही»। जिसमें कुछ बदलना है, उसके लिए «सतत», और «एकदम सही» की कोई भी सेटिंग संपादन योग्य पाठ नहीं देगी।
«एकदम सही» फ़ाइल के भीतर क्या पड़ा है
पृष्ठ की छवि उसकी पूरी सामग्री नहीं है। उसके नीचे PDF से निकाला गया पाठ भी रखा जाता है, छिपा हुआ चिह्नित: पर्दे पर और छपाई में वह नहीं होता, पर दस्तावेज़ की खोज उसे पा लेती है।
इसी से यह ढंग वहाँ काम का हो जाता है जहाँ बेकार लगता है। जिस अनुबंध को बाँटना है और बाद में उसमें शब्दावली खोजनी है, वह इसी रूप में ठीक चलता है: शक्ल बची रहती है, खोज चलती है, और गलती से कोई संपादन नहीं होता। औज़ार स्वयं भी प्रसंस्करण के बाद चेताता है कि दस्तावेज़ संपादन योग्य पाठ नहीं है; वह संदेश बंद करने के बजाय पढ़ लेना चाहिए।
पृष्ठ का आकार और दिशा मूल PDF से पृष्ठवार ली जाती है। खड़े दस्तावेज़ के बीच पड़ा आड़ा पन्ना आड़ा ही रहता है।
संपादन योग्य दस्तावेज़ कैसे पाएँ
1. pdf-to-word खोलिए और फ़ाइल चढ़ाइए। 2. परिणाम का प्रकार «सतत» कर दीजिए। यही निर्णायक क्रिया है, और पहले से यह नहीं की गई होती। 3. तय कीजिए कि पृष्ठों की झलकें चाहिए या नहीं; इस पर आगे बात है, न चाहिए तो बंद कर दीजिए। 4. प्रसंस्करण चलाइए और .docx डाउनलोड कीजिए। 5. दस्तावेज़ खोलिए और नेविगेशन फलक देखिए: वह बताता है कौन-से शीर्षक पहचाने गए। 6. तालिकाएँ और पहला पृष्ठ जाँचिए, नुक़सान वहीं सबसे पहले दिखता है।
दोहराए जाने वाले शीर्ष-पाद जान-बूझकर हटते हैं
सतत ढंग पूरे दस्तावेज़ पर एक अलग चक्कर लगाकर दोहराई जाने वाली पंक्तियाँ खोजता है। दो शर्तें हैं: पंक्ति पृष्ठ के ऊपरी या निचले दसवें हिस्से में हो, और कम से कम तीन पृष्ठों पर तथा कम से कम आधे दस्तावेज़ पर दोहराई जाए। दोनों पर खरी हर चीज़ परिणाम से निकाल दी जाती है।
तुलना भोली नहीं है। अंकों की लड़ियाँ सिकुड़ जाती हैं, इसलिए «पृष्ठ 4» और «पृष्ठ 5» एक ही पंक्ति गिनी जाती हैं। पर सिकुड़ना तभी लगता है जब पंक्ति में अक्षर बचे रहें: पाद में पड़ी नंगी संख्या की तुलना हूबहू होती है, और तीन पृष्ठों के तीन अलग अंक आपस में बराबर नहीं। व्यवहार में «गोपनीय। पृष्ठ 7» जैसा पाद चला जाता है, जबकि केवल अंक वाला पाद हर पृष्ठ पर अलग अनुच्छेद बनकर रह जाता है।
चार पृष्ठ की रिपोर्ट पर जाँचा गया: पंक्ति `Confidential report Page N` सतत परिणाम में नहीं मिलती और «एकदम सही» में मौजूद रहती है, जहाँ पृष्ठ वैसे भी छवि है और उसमें से कुछ हटाया ही नहीं जा सकता।
इस तंत्र का उलटा पहलू भी है। हर पृष्ठ के सबसे ऊपर बड़े अक्षरों में लिखा और सब जगह एक जैसा दस्तावेज़-नाम इसी नियम में आता है और शीर्ष-पाद के साथ मिट जाता है। यदि वह ऊपरी पंक्ति मायने रखती है, तो कारण खोजने से जल्दी उसे दोबारा टाइप कर लेना है।
शीर्षक फ़ॉन्ट के आकार से तय होते हैं
परिणाम की शीर्षक शैलियाँ गढ़ी नहीं जातीं। औज़ार पहले पूरे दस्तावेज़ के लिए हिसाब लगाता है कि मुख्य पाठ का फ़ॉन्ट आकार कौन-सा है। गिनती पंक्तियों की नहीं, वर्णों की होती है, इसलिए कोई इक्का-दुक्का बड़ी पंक्ति कभी नहीं जीतती।
फिर हर खंड इसी आकार से नापा जाता है। मुख्य आकार से लगभग 15 प्रतिशत बड़ा दूसरे स्तर का शीर्षक बनता है, डेढ़ गुना या अधिक पहले स्तर का। बाकी सब सामान्य अनुच्छेद रहता है। पाठ को शीर्षक जैसा दिखना भी चाहिए: पूर्णविराम पर ख़त्म होता लंबा वाक्य शीर्षक नहीं बनेगा, चाहे किसी भी फ़ॉन्ट में हो।
इससे बिना शैलियों के बने दस्तावेज़ों का व्यवहार पहले से पता चल जाता है। यदि पूरा पाठ एक ही आकार में है और खंड केवल मोटे अक्षरों से अलग किए गए हैं, तो Word फ़ाइल में एक भी शीर्षक नहीं होगा: आकार बदलता ही नहीं, पकड़ने को कुछ है ही नहीं। नेविगेशन फलक खाली निकलेगा और ढाँचा हाथ से डालना पड़ेगा।
तालिकाएँ तालिकाएँ ही बनती हैं
तालिकाएँ एक अलग पहचानकर्ता खोजता है, वही जिस पर pdf-to-excel टिका है। पहचानी गई तालिका दस्तावेज़ में असली Word तालिका बनकर आती है, दिखती हुई जाली के साथ, न कि खाली जगहों से भरे अनुच्छेदों के रूप में।
पहचानी गई तालिका की सीमाओं के भीतर पड़े पाठ-खंड अनुच्छेदों की धारा से हटा दिए जाते हैं; वरना कोष्ठकों की सामग्री दो बार आती, एक बार तालिका बनकर और एक बार गद्य बनकर। सीमा-रेखा खंड के क्षेत्रफल के छह दसवें हिस्से की ओवरलैप है।
तालिका कहाँ बैठेगी, यह उसके ऊपरी किनारे से तय होता है: वह उस पहले अनुच्छेद से पहले डाली जाती है जो उसके नीचे शुरू होता है। सामान्य एक-स्तंभी पृष्ठ पर इससे सही क्रम बनता है। दो-स्तंभी पृष्ठ पर तालिका कहीं और जा सकती है, क्योंकि दोनों स्तंभों के अनुच्छेद फ़ाइल में एक के बाद एक आते हैं जबकि उनकी ऊँचाइयाँ आपस में गुँथी होती हैं।
यदि किसी पृष्ठ पर तालिका की पहचान विफल हो जाए, तो काम गिरता नहीं: वह पृष्ठ सामान्य पाठ बनकर आता है और उत्तर में उन पृष्ठों की संख्या बताती चेतावनी जुड़ जाती है। यहाँ चुपचाप खाली उत्तर संभव नहीं।
फ़ाइल का वज़न और पृष्ठों की झलकें
सतत ढंग पहले से हर पृष्ठ के पाठ के बाद उसी पृष्ठ की छवि जोड़ता है, ताकि मिलान के लिए कुछ रहे। वज़न पर इससे ज़्यादा और कुछ असर नहीं डालता।
एक ही चार पृष्ठ के दस्तावेज़ पर मापा गया:
| परिणाम | आकार |
|---|---|
| «एकदम सही» ढंग | 671 KB |
| झलकों के साथ सतत | 315 KB |
| झलकों के बिना सतत | 37 KB |
मूल PDF का वज़न लगभग 4 KB था। सबसे ऊपरी और सबसे निचली पंक्ति का अंतर अठारह गुना है, और वह पूरा का पूरा छवियों का है। यदि दस्तावेज़ असली काम में जा रहा है, मिलान में नहीं, तो झलकें तुरंत बंद कर दीजिए: वे संपादित नहीं होतीं, पाठ में भाग नहीं लेतीं और प्रूफ़ पढ़ते समय बाधा बनती हैं।
«एकदम सही» ढंग इस सेटिंग की परवाह ही नहीं करता, उसका पृष्ठ तो पहले से छवि है।
बिना पाठ परत वाला स्कैन
स्कैन किया दस्तावेज़ एक छवि है, और उसमें से निकालने को कुछ है ही नहीं। «एकदम सही» ढंग में परिणाम वही स्कैन होगा, .docx में लपेटा हुआ। सतत ढंग में पृष्ठ खाली निकलेंगे, और हर पृष्ठ की जगह उसके ख़ाली होने की सूचना रह जाएगी।
इलाज रूपांतरण से पहले है, बाद में नहीं: फ़ाइल को ocr-pdf से गुज़ारिए, पाठ परत वाला PDF पाइए और तभी Word में बदलिए। उलटा क्रम काम नहीं करता, क्योंकि तब पहचानने को कुछ बचेगा ही नहीं।
खोलने के पासवर्ड से बंद दस्तावेज़ भी नहीं बदलेगा; काम रुक जाएगा और पासवर्ड माँगेगा। सुरक्षा unlock-pdf से हटाइए। जो पासवर्ड केवल छपाई या नक़ल रोकता है, वह बाधा नहीं बनता।
सुधार हो जाने पर दस्तावेज़ को प्रायः वापस PDF बनाना होता है। उसके लिए word-to-pdf है, जिसका फ़ॉन्ट बदलने का अपना बरताव है और उसे पहले से जान लेना बेहतर रहता है।
FAQ
इस क्लस्टर से और
चरण-दर-चरण मार्गदर्शिका
PDF से Excel में टेबल कैसे निकालें
PDF से Excel: डाउनलोड की गई कार्यपुस्तिका में कौन-सी शीटें आती हैं, पहचान के तीन ढंग व्यवहार में कैसे अलग हैं, और लचीला ढंग अधिक तालिकाएँ पाकर भी शब्द क्यों तोड़ देता है।
चरण-दर-चरण मार्गदर्शिका
PDF से चुनिंदा पेज अलग फाइल में लें
PDF से ज़रूरी पन्ने अलग फ़ाइल के रूप में निकालना: दोनों आउटपुट ढंग किस तरह अलग हैं, संग्रह की फ़ाइलें मूल पृष्ठ संख्याएँ क्यों सँभाले रखती हैं, और आकार सुरक्षित रखना बंद करने से क्या होता है।
चरण-दर-चरण मार्गदर्शिका
PDF पेज के मार्जिन और कचरा क्रॉप करें
कटाई सिर्फ़ पेज का दिखने वाला हिस्सा बदलती है, जबकि उसके बाहर की सामग्री फ़ाइल में बनी रहती है। व्यवहार में इसका क्या अर्थ है, मार्जिन पूरे दस्तावेज़ पर क्यों लगते हैं, और घुमाई गई पेज पर कटाई कैसे बरतती है।
संबंधित टूल
PDF से Word ऑनलाइन
PDF को Word document में बदलें ताकि text संपादित करें, sections बढ़ाएँ और बदलाव करें.
Word से PDF ऑनलाइन
Word document को PDF में बदलें ताकि layout तय रहे और file हर जगह एक जैसी खुले.
PDF से Excel ऑनलाइन
PDF के table डेटा को Excel में निकालें ताकि गणना, filter और sort किया जा सके.
ओसीआर पीडीएफ ऑनलाइन
ओसीआर पीडीएफ PDF कार्य को एक ही ब्राउज़र प्रवाह में रखता है: स्रोत फ़ाइल अपलोड करें, विकल्प देखें, प्रक्रिया चलाएँ और परिणाम डाउनलोड करें.
आगे क्या करें
सभी टूल्स
PDF tools catalog: PDF merge, compress, split, convert, rotate, protect और unlock करें, सब कुछ सीधे आपके browser में.
अक्सर पूछे जाने वाले प्रश्न
iHatePDF के बारे में frequently asked questions के जवाब: क्या registration जरूरी है, files कैसे process होती हैं, limits कहाँ देखें और documents upload करना safe है या नहीं।
संपर्क
Processing errors, tool चुनने, safety, business queries और नए features के सुझावों के लिए iHatePDF से संपर्क करें।