मुख्य सामग्री पर जाएं
लेख

PDF को एडिट करने योग्य Word में बदलें

फ़ाइल Word में खुल गई पर कर्सर पाठ में नहीं घुसता? पहले से चुनी सेटिंग छवि क्यों देती है, सतत ढंग «एकदम सही» से कैसे अलग है, और शीर्ष-पाद कहाँ चले गए।

संक्षेप में: सचमुच संपादन योग्य Word पाने के लिए pdf-to-word में परिणाम का प्रकार «सतत» कर दीजिए: पहले से «एकदम सही» लगा रहता है, जो हर पृष्ठ को खोज के लिए छिपी परत सहित छवि बनाकर डालता है। सतत ढंग अनुच्छेद, शीर्षक और असली Word तालिकाएँ बनाता है।

क्लस्टर

चरण-दर-चरण मार्गदर्शिका

इनपुट से भरोसेमंद परिणाम तक PDF कार्य ले जाने के लिए चरण-दर-चरण निर्देश.

13 लेख

मुख्य टूल

PDF से Word ऑनलाइन

इस लेख वाला टूल खोलें और मौजूदा लोकैल में ऑपरेशन पूरा करें.

टूल खोलें

विषय-सूची

PDF को संपादन योग्य Word में कैसे बदलें

माँग लगभग हमेशा एक ही होती है: भेजे गए PDF में दो अनुच्छेद सुधारने हैं। और पहली कोशिश लगभग हमेशा निराश करती है। फ़ाइल Word में खुलती है, दिखने में एकदम ठीक, पर कर्सर पाठ में घुसता ही नहीं। यह रूपांतरण की गड़बड़ी नहीं, बल्कि उस सेटिंग का नतीजा है जो पहले से लगी रहती है।

पहले से चुनी सेटिंग में छवि मिलती है, पाठ नहीं

औज़ार के दो ढंग हैं, और उनके बीच का चयन «परिणाम का प्रकार» कहलाता है। पहले से «एकदम सही» चुना रहता है, और वह वही करता है जिसका वादा है: पृष्ठ की शक्ल अक्षरशः बचा लेता है। तरीका इसमें बेरहम है: PDF का हर पृष्ठ छवि के रूप में बनाया जाता है और पूरा का पूरा Word दस्तावेज़ में चिपका दिया जाता है।

इसी से बदल दिए जाने का एहसास होता है। यह .docx है, Word में खुलता है, पृष्ठ मूल से आकार और दिशा में मेल खाते हैं, और संपादन के लिए कुछ है ही नहीं: पृष्ठ पर छवियाँ पड़ी हैं।

दूसरा ढंग, सतत, पृष्ठ को टुकड़ों में खोलता है और उनसे असली Word दस्तावेज़ बनाता है: अनुच्छेद, शीर्षक, सूचियाँ और तालिकाएँ। बदले में पृष्ठ पर तत्वों की ठीक-ठीक जगह चली जाती है।

ढंगभीतर क्या हैक्या किया जा सकता है
एकदम सहीहर पृष्ठ की छवि और उसके नीचे छिपी पाठ परतपढ़ना, पाठ में खोजना, छापना
सततWord के अनुच्छेद, शीर्षक, सूचियाँ और तालिकाएँपाठ बदलना, शैलियाँ बदलना, तालिकाओं पर काम करना

चुनाव गुणवत्ता का नहीं, काम का है। जिस दस्तावेज़ को परिचित दफ़्तरी रूप में आगे भेजना है और छूना नहीं, उसके लिए «एकदम सही»। जिसमें कुछ बदलना है, उसके लिए «सतत», और «एकदम सही» की कोई भी सेटिंग संपादन योग्य पाठ नहीं देगी।

«एकदम सही» फ़ाइल के भीतर क्या पड़ा है

पृष्ठ की छवि उसकी पूरी सामग्री नहीं है। उसके नीचे PDF से निकाला गया पाठ भी रखा जाता है, छिपा हुआ चिह्नित: पर्दे पर और छपाई में वह नहीं होता, पर दस्तावेज़ की खोज उसे पा लेती है।

इसी से यह ढंग वहाँ काम का हो जाता है जहाँ बेकार लगता है। जिस अनुबंध को बाँटना है और बाद में उसमें शब्दावली खोजनी है, वह इसी रूप में ठीक चलता है: शक्ल बची रहती है, खोज चलती है, और गलती से कोई संपादन नहीं होता। औज़ार स्वयं भी प्रसंस्करण के बाद चेताता है कि दस्तावेज़ संपादन योग्य पाठ नहीं है; वह संदेश बंद करने के बजाय पढ़ लेना चाहिए।

पृष्ठ का आकार और दिशा मूल PDF से पृष्ठवार ली जाती है। खड़े दस्तावेज़ के बीच पड़ा आड़ा पन्ना आड़ा ही रहता है।

संपादन योग्य दस्तावेज़ कैसे पाएँ

1. pdf-to-word खोलिए और फ़ाइल चढ़ाइए। 2. परिणाम का प्रकार «सतत» कर दीजिए। यही निर्णायक क्रिया है, और पहले से यह नहीं की गई होती। 3. तय कीजिए कि पृष्ठों की झलकें चाहिए या नहीं; इस पर आगे बात है, न चाहिए तो बंद कर दीजिए। 4. प्रसंस्करण चलाइए और .docx डाउनलोड कीजिए। 5. दस्तावेज़ खोलिए और नेविगेशन फलक देखिए: वह बताता है कौन-से शीर्षक पहचाने गए। 6. तालिकाएँ और पहला पृष्ठ जाँचिए, नुक़सान वहीं सबसे पहले दिखता है।

दोहराए जाने वाले शीर्ष-पाद जान-बूझकर हटते हैं

सतत ढंग पूरे दस्तावेज़ पर एक अलग चक्कर लगाकर दोहराई जाने वाली पंक्तियाँ खोजता है। दो शर्तें हैं: पंक्ति पृष्ठ के ऊपरी या निचले दसवें हिस्से में हो, और कम से कम तीन पृष्ठों पर तथा कम से कम आधे दस्तावेज़ पर दोहराई जाए। दोनों पर खरी हर चीज़ परिणाम से निकाल दी जाती है।

तुलना भोली नहीं है। अंकों की लड़ियाँ सिकुड़ जाती हैं, इसलिए «पृष्ठ 4» और «पृष्ठ 5» एक ही पंक्ति गिनी जाती हैं। पर सिकुड़ना तभी लगता है जब पंक्ति में अक्षर बचे रहें: पाद में पड़ी नंगी संख्या की तुलना हूबहू होती है, और तीन पृष्ठों के तीन अलग अंक आपस में बराबर नहीं। व्यवहार में «गोपनीय। पृष्ठ 7» जैसा पाद चला जाता है, जबकि केवल अंक वाला पाद हर पृष्ठ पर अलग अनुच्छेद बनकर रह जाता है।

चार पृष्ठ की रिपोर्ट पर जाँचा गया: पंक्ति `Confidential report Page N` सतत परिणाम में नहीं मिलती और «एकदम सही» में मौजूद रहती है, जहाँ पृष्ठ वैसे भी छवि है और उसमें से कुछ हटाया ही नहीं जा सकता।

इस तंत्र का उलटा पहलू भी है। हर पृष्ठ के सबसे ऊपर बड़े अक्षरों में लिखा और सब जगह एक जैसा दस्तावेज़-नाम इसी नियम में आता है और शीर्ष-पाद के साथ मिट जाता है। यदि वह ऊपरी पंक्ति मायने रखती है, तो कारण खोजने से जल्दी उसे दोबारा टाइप कर लेना है।

शीर्षक फ़ॉन्ट के आकार से तय होते हैं

परिणाम की शीर्षक शैलियाँ गढ़ी नहीं जातीं। औज़ार पहले पूरे दस्तावेज़ के लिए हिसाब लगाता है कि मुख्य पाठ का फ़ॉन्ट आकार कौन-सा है। गिनती पंक्तियों की नहीं, वर्णों की होती है, इसलिए कोई इक्का-दुक्का बड़ी पंक्ति कभी नहीं जीतती।

फिर हर खंड इसी आकार से नापा जाता है। मुख्य आकार से लगभग 15 प्रतिशत बड़ा दूसरे स्तर का शीर्षक बनता है, डेढ़ गुना या अधिक पहले स्तर का। बाकी सब सामान्य अनुच्छेद रहता है। पाठ को शीर्षक जैसा दिखना भी चाहिए: पूर्णविराम पर ख़त्म होता लंबा वाक्य शीर्षक नहीं बनेगा, चाहे किसी भी फ़ॉन्ट में हो।

इससे बिना शैलियों के बने दस्तावेज़ों का व्यवहार पहले से पता चल जाता है। यदि पूरा पाठ एक ही आकार में है और खंड केवल मोटे अक्षरों से अलग किए गए हैं, तो Word फ़ाइल में एक भी शीर्षक नहीं होगा: आकार बदलता ही नहीं, पकड़ने को कुछ है ही नहीं। नेविगेशन फलक खाली निकलेगा और ढाँचा हाथ से डालना पड़ेगा।

तालिकाएँ तालिकाएँ ही बनती हैं

तालिकाएँ एक अलग पहचानकर्ता खोजता है, वही जिस पर pdf-to-excel टिका है। पहचानी गई तालिका दस्तावेज़ में असली Word तालिका बनकर आती है, दिखती हुई जाली के साथ, न कि खाली जगहों से भरे अनुच्छेदों के रूप में।

पहचानी गई तालिका की सीमाओं के भीतर पड़े पाठ-खंड अनुच्छेदों की धारा से हटा दिए जाते हैं; वरना कोष्ठकों की सामग्री दो बार आती, एक बार तालिका बनकर और एक बार गद्य बनकर। सीमा-रेखा खंड के क्षेत्रफल के छह दसवें हिस्से की ओवरलैप है।

तालिका कहाँ बैठेगी, यह उसके ऊपरी किनारे से तय होता है: वह उस पहले अनुच्छेद से पहले डाली जाती है जो उसके नीचे शुरू होता है। सामान्य एक-स्तंभी पृष्ठ पर इससे सही क्रम बनता है। दो-स्तंभी पृष्ठ पर तालिका कहीं और जा सकती है, क्योंकि दोनों स्तंभों के अनुच्छेद फ़ाइल में एक के बाद एक आते हैं जबकि उनकी ऊँचाइयाँ आपस में गुँथी होती हैं।

यदि किसी पृष्ठ पर तालिका की पहचान विफल हो जाए, तो काम गिरता नहीं: वह पृष्ठ सामान्य पाठ बनकर आता है और उत्तर में उन पृष्ठों की संख्या बताती चेतावनी जुड़ जाती है। यहाँ चुपचाप खाली उत्तर संभव नहीं।

फ़ाइल का वज़न और पृष्ठों की झलकें

सतत ढंग पहले से हर पृष्ठ के पाठ के बाद उसी पृष्ठ की छवि जोड़ता है, ताकि मिलान के लिए कुछ रहे। वज़न पर इससे ज़्यादा और कुछ असर नहीं डालता।

एक ही चार पृष्ठ के दस्तावेज़ पर मापा गया:

परिणामआकार
«एकदम सही» ढंग671 KB
झलकों के साथ सतत315 KB
झलकों के बिना सतत37 KB

मूल PDF का वज़न लगभग 4 KB था। सबसे ऊपरी और सबसे निचली पंक्ति का अंतर अठारह गुना है, और वह पूरा का पूरा छवियों का है। यदि दस्तावेज़ असली काम में जा रहा है, मिलान में नहीं, तो झलकें तुरंत बंद कर दीजिए: वे संपादित नहीं होतीं, पाठ में भाग नहीं लेतीं और प्रूफ़ पढ़ते समय बाधा बनती हैं।

«एकदम सही» ढंग इस सेटिंग की परवाह ही नहीं करता, उसका पृष्ठ तो पहले से छवि है।

बिना पाठ परत वाला स्कैन

स्कैन किया दस्तावेज़ एक छवि है, और उसमें से निकालने को कुछ है ही नहीं। «एकदम सही» ढंग में परिणाम वही स्कैन होगा, .docx में लपेटा हुआ। सतत ढंग में पृष्ठ खाली निकलेंगे, और हर पृष्ठ की जगह उसके ख़ाली होने की सूचना रह जाएगी।

इलाज रूपांतरण से पहले है, बाद में नहीं: फ़ाइल को ocr-pdf से गुज़ारिए, पाठ परत वाला PDF पाइए और तभी Word में बदलिए। उलटा क्रम काम नहीं करता, क्योंकि तब पहचानने को कुछ बचेगा ही नहीं।

खोलने के पासवर्ड से बंद दस्तावेज़ भी नहीं बदलेगा; काम रुक जाएगा और पासवर्ड माँगेगा। सुरक्षा unlock-pdf से हटाइए। जो पासवर्ड केवल छपाई या नक़ल रोकता है, वह बाधा नहीं बनता।

सुधार हो जाने पर दस्तावेज़ को प्रायः वापस PDF बनाना होता है। उसके लिए word-to-pdf है, जिसका फ़ॉन्ट बदलने का अपना बरताव है और उसे पहले से जान लेना बेहतर रहता है।

FAQ

क्योंकि परिणाम का प्रकार पहले से «एकदम सही» है: हर पृष्ठ छवि के रूप में डाला जाता है और उसके नीचे खोज के लिए छिपी पाठ परत रहती है। संपादन योग्य दस्तावेज़ के लिए परिणाम का प्रकार «सतत» कीजिए और फिर से बदलिए।
सतत ढंग में पहचानी गई तालिकाएँ दिखती जाली वाली असली Word तालिकाओं के रूप में आती हैं। यदि किसी पृष्ठ पर पहचान विफल हो जाए, तो उसकी सामग्री सामान्य पाठ बनकर आती है और उत्तर में उन पृष्ठों की संख्या बताती चेतावनी जुड़ती है।
सतत ढंग उन पंक्तियों को हटा देता है जो पृष्ठ के ऊपरी या निचले दसवें हिस्से में हों और कम से कम तीन पृष्ठों तथा कम से कम आधे दस्तावेज़ पर दोहराई जाएँ। हर पृष्ठ के ऊपर लिखा एक जैसा दस्तावेज़-नाम भी इसी नियम में आता है।
सीधे नहीं। स्कैन में पाठ परत नहीं होती, इसलिए सतत ढंग खाली पृष्ठ लौटाता है। पहले फ़ाइल को ocr-pdf से गुज़ारिए और फिर बने PDF को Word में बदलिए।
फ़ाइलें केवल चुने गए ऑपरेशन के लिए उपयोग की जाती हैं और प्रसंस्करण पूरा होने के बाद स्वतः हटा दी जाती हैं। हम अपलोड किए गए दस्तावेज़ों का उपयोग AI मॉडल के प्रशिक्षण के लिए नहीं करते।

इस क्लस्टर से और

चरण-दर-चरण मार्गदर्शिका

PDF से Excel में टेबल कैसे निकालें

PDF से Excel: डाउनलोड की गई कार्यपुस्तिका में कौन-सी शीटें आती हैं, पहचान के तीन ढंग व्यवहार में कैसे अलग हैं, और लचीला ढंग अधिक तालिकाएँ पाकर भी शब्द क्यों तोड़ देता है।

चरण-दर-चरण मार्गदर्शिका

PDF से चुनिंदा पेज अलग फाइल में लें

PDF से ज़रूरी पन्ने अलग फ़ाइल के रूप में निकालना: दोनों आउटपुट ढंग किस तरह अलग हैं, संग्रह की फ़ाइलें मूल पृष्ठ संख्याएँ क्यों सँभाले रखती हैं, और आकार सुरक्षित रखना बंद करने से क्या होता है।

चरण-दर-चरण मार्गदर्शिका

PDF पेज के मार्जिन और कचरा क्रॉप करें

कटाई सिर्फ़ पेज का दिखने वाला हिस्सा बदलती है, जबकि उसके बाहर की सामग्री फ़ाइल में बनी रहती है। व्यवहार में इसका क्या अर्थ है, मार्जिन पूरे दस्तावेज़ पर क्यों लगते हैं, और घुमाई गई पेज पर कटाई कैसे बरतती है।

संबंधित टूल

← रूपांतरण श्रेणी के सभी टूल

आगे क्या करें

अगर पढ़ने के बाद आपको अगला व्यावहारिक कदम या सेवा के बारे में और मार्गदर्शन चाहिए, तो ये पेज खोलें.

सभी टूल्स

PDF tools catalog: PDF merge, compress, split, convert, rotate, protect और unlock करें, सब कुछ सीधे आपके browser में.

अक्सर पूछे जाने वाले प्रश्न

iHatePDF के बारे में frequently asked questions के जवाब: क्या registration जरूरी है, files कैसे process होती हैं, limits कहाँ देखें और documents upload करना safe है या नहीं।

संपर्क

Processing errors, tool चुनने, safety, business queries और नए features के सुझावों के लिए iHatePDF से संपर्क करें।