मुख्य सामग्री पर जाएं
लेख

HTML से PDF: वेब पेज सेव करें

टूल पेज का पता नहीं, सहेजी हुई HTML फ़ाइल लेता है और उसे अलग-थलग ब्राउज़र में बनाता है। इसीलिए नियम बनते हैं: स्थानीय तस्वीरें नहीं आतीं, और लोड होने के बाद जो कुछ आता है वह PDF तक कभी नहीं पहुँचता।

संक्षेप में: पेज को बिना इंटरफ़ेस वाला ब्राउज़र आपकी अपलोड की HTML फ़ाइल से बनाता है। स्थानीय पथ बिल्कुल नहीं माँगे जाते, और बाहरी पते सिर्फ़ वही जो ख़ुद HTML में दिखते हैं। भरोसेमंद संग्रह एक ही आत्मनिर्भर फ़ाइल से बनता है जिसमें सब कुछ भीतर समाया हो।

क्लस्टर

सुरक्षा

सुरक्षा, पहुँच नियंत्रण, रेडैक्शन और नियंत्रित साझा करने के प्रवाह.

4 लेख

मुख्य टूल

HTML से PDF ऑनलाइन

इस लेख वाला टूल खोलें और मौजूदा लोकैल में ऑपरेशन पूरा करें.

टूल खोलें

विषय-सूची

वेब पेज को PDF में सहेजना: संग्रह में क्या पहुँचता है और क्या नहीं

पेज ऐसे रखना है कि एक साल बाद वह खुले और आज जैसा ही दिखे: सेवा की शर्तें, शुल्क का पन्ना, ऐसा लेख जिसे कोई संपादित कर सकता है। इसके लिए PDF स्क्रीनशॉट से बेहतर है, क्योंकि टेक्स्ट बचा रहता है, और बुकमार्क से बेहतर है, क्योंकि वह पराए सर्वर पर निर्भर नहीं।

पर «ब्राउज़र में पेज» और «PDF में पेज» के बीच कुछ क़दम हैं जहाँ सामग्री खो जाती है। देखते हैं कहाँ।

टूल फ़ाइल लेता है, पेज का पता नहीं

पहली समझने लायक़ बात: इसमें किसी साइट का पता नहीं लिखा जाता। सहेजी हुई HTML फ़ाइल अपलोड की जाती है।

पेज सहेजना ब्राउज़र जानता है। सहेजने के संवाद में आम तौर पर «सिर्फ़ HTML» और पूरे पेज को समेटने वाले विकल्प के बीच चुनाव होता है। दूसरा विकल्प साफ़ तौर पर बेहतर है: वह मार्कअप, शैलियाँ और तस्वीरें एक फ़ाइल में इकट्ठा कर देता है, और संग्रह को यही चाहिए।

ऐसा क्यों बना है, यह अगला हिस्सा समझाता है, और वही व्याख्या अधिकांश अप्रत्याशित नतीजों को भी ढक लेती है।

तस्वीरें क्यों ग़ायब हो जाती हैं

पेज अलग-थलग ब्राउज़र में बनाया जाता है, और सामग्री उसे सीधे सौंपी जाती है, फ़ाइल पथ से खोली नहीं जाती। ऐसे पेज की डिस्क पर कोई जगह नहीं होती जहाँ से वह पड़ोसी फ़ाइलें पढ़ सके।

इससे सख़्त नियम बनता है: स्थानीय फ़ाइलों के संदर्भ काम नहीं करते। अगर आपकी `page.html` के बगल में तस्वीरों से भरा `page_files` फ़ोल्डर है, तो उनमें से एक भी PDF तक नहीं पहुँचेगी। ब्राउज़र उन तक पहुँच ही नहीं सकता।

बाहरी पते चलते हैं, पर कोई भी नहीं। चित्रण से पहले HTML की स्थिर जाँच होती है, उससे पतों की सूची बनती है, और सिर्फ़ वही लाए जाते हैं। जिस संसाधन के बारे में मार्कअप कुछ नहीं कहता, वह रोक दिया जाता है, और किसी दूसरे पते पर पुनर्निर्देशन भी।

एक व्यावहारिक निष्कर्ष निकलता है: भरोसेमंद संग्रह उसी आत्मनिर्भर फ़ाइल से बनता है जिसमें तस्वीरें और शैलियाँ मार्कअप के भीतर समाई हों, बगल में पड़ी न हों।

लोड होने के बाद जो आता है, वह PDF तक नहीं पहुँचता

नुक़सान का दूसरा स्रोत गतिशीलता है।

आजकल का पेज अक्सर खुलने के बाद सामग्री लाता है: स्क्रॉल करते-करते तस्वीरें, क्लिक पर टिप्पणियाँ, अलग अनुरोध से आँकड़ों की तालिका। चित्रण मार्कअप पर काम करता है, जीवित पेज पर नहीं, और जो बाद में लोड होता है वह उसमें है ही नहीं।

इसी कारण मुड़े हुए ब्लॉक मुड़े ही रहते हैं, सक्रिय के अलावा बाक़ी टैब ग़ायब रहते हैं, और माउस ले जाने पर दिखने वाला सब कुछ नहीं आता।

आप पहले से जाँच सकते हैं: ब्राउज़र में स्क्रिप्ट बंद कीजिए और पेज दोबारा लोड कीजिए। जो दिखता रह जाए वह PDF तक पहुँचेगा। जो ग़ायब हो जाए, नहीं।

PDF संग्रह स्क्रीनशॉट और बुकमार्क से कैसे अलग है

पेज सहेजने के तीन तरीक़े अलग-अलग समस्याएँ हल करते हैं, और उन्हें मिला देना महँगा पड़ता है।

तरीक़ाक्या बचता हैक्या नहीं होता
बुकमार्कपते के सिवा कुछ नहींपेज बदल सकता है या हट सकता है
स्क्रीनशॉटदिखने वाले हिस्से की तस्वीरटेक्स्ट न खोजा जा सकता है न कॉपी, लंबा पेज समाता नहीं
PDFटेक्स्ट, सजावट, सभी पेज पूरेअंतःक्रिया और स्क्रिप्ट से आने वाला सब

प्रमाण के काम में दूसरी पंक्ति का तीसरा स्तंभ मायने रखता है। शुल्क पन्ने का स्क्रीनशॉट खोज से कोई खंड नहीं ढूँढ़ने देता और यह नहीं दिखाता कि नीचे क्या था। PDF दोनों कर देती है।

अलग से याद रखने लायक़: इन तीनों में से कोई भी किसी तिथि पर पेज की सामग्री का क़ानूनी प्रमाण नहीं है। उसके लिए नोटरी प्रमाणन होता है, और वह अलग ढंग से काम करता है।

सहेजना कैसे करें

1. पेज ब्राउज़र में खोलिए और एक-फ़ाइल विकल्प चुनकर HTML के रूप में सहेजिए। 2. html-to-pdf खोलिए और सहेजी फ़ाइल अपलोड कीजिए। 3. पेज का आकार चुनिए: A4 या Letter। 4. सजावट मायने रखती हो तो पृष्ठभूमि ग्राफ़िक चालू रहने दीजिए। 5. प्रोसेस चलाइए और नतीजे की मूल पेज से तुलना कीजिए।

पाँचवाँ क़दम तुरंत कीजिए, महीने भर बाद नहीं: कुछ खो गया हो तो पेज अभी उपलब्ध है और उसे दूसरे तरीक़े से सहेजा जा सकता है।

पृष्ठभूमि ग्राफ़िक और उसे चालू क्यों रखें

पृष्ठभूमि ग्राफ़िक का स्विच तय करता है कि भराव, पृष्ठभूमि तस्वीरें और रंगीन पट्टियाँ PDF तक पहुँचें या नहीं।

यह डिफ़ॉल्ट रूप से चालू है, और संग्रह के लिए यही सही है: बंद होने पर रंगीन पट्टी पर लिखा टेक्स्ट सफ़ेद पर लिखा टेक्स्ट बन जाता है, और सजावट का कुछ अर्थ खो जाता है। यह ख़ासकर रंग से चिह्नित चेतावनियों और बारी-बारी रंग वाली पंक्तियों की तालिकाओं में दिखता है।

इसे बंद करने की ठीक एक वजह है: पेज छपाई में जा रहा है और भराव टोनर खा जाएगा। संग्रह के लिए चालू ही रखिए।

पेज का आकार और चौड़ी तालिकाएँ

पेज का आकार डिफ़ॉल्ट रूप से A4 है। यहाँ चुनाव सिर्फ़ A4 और Letter के बीच है; मनचाहा फ़ॉर्मैट नहीं।

इससे एक अटल समस्या निकलती है। वेब पेज की कोई चौड़ाई नहीं होती: वह खिड़की के हिसाब से ढल जाता है। PDF की चौड़ाई तय होती है। जो चौड़ी तालिका ब्राउज़र में बग़ल में सरकती थी, वह PDF में शीट के किनारे पर कट जाएगी।

टूल के भीतर इसका कोई रास्ता नहीं। बाहर से निकाला जाता है: सहेजने से पहले ब्राउज़र में पेज का ज़ूम घटा दीजिए, तब तालिका चौड़ाई में समा जाएगी।

HTML कब सादा टेक्स्ट बन जाता है

एक स्वचालित तेज़ रास्ता है। बहुत बड़ी HTML फ़ाइलें, जिनमें न तस्वीरें हैं, न तालिकाएँ, न भीतर लिखी शैलियाँ, न मीडिया, सादे टेक्स्ट के रूप में बनती हैं, बिना किसी विन्यास के।

यह जानबूझकर लिया गया फ़ैसला है: कई मेगाबाइट के शुद्ध टेक्स्ट वाले पेज को पूरा चित्रित करना महँगा है और नतीजा वही देता है।

यह चुपचाप नहीं होता। नतीजे के साथ चेतावनी आती है कि दस्तावेज़ सरलीकृत रूप में बना और सजावट नहीं बची। यह नतीजा आपके काम का न हो तो फ़ाइल ग़लती से इस नियम में आ गई, और पेज को ऐसे दोबारा सहेजना चाहिए कि उसका मार्कअप बना रहे।

तैयार संग्रह का क्या करें

तीन क़दम जो तुरंत करने लायक़ हैं।

वज़न जाँचिए। तस्वीरों से भरा पेज भारी PDF देता है, और compress-pdf उसे टेक्स्ट छुए बिना घटा देगा।

दस्तावेज़ के गुण भरिए। HTML से बनी PDF में शीर्षक का खाना आम तौर पर ख़ाली रहता है या उसमें कोई तकनीकी पंक्ति होती है। set-pdf-metadata से सार्थक शीर्षक और तारीख़ एक साल बाद संग्रह में खोज बहुत आसान कर देते हैं।

अगर कई पेज मिलकर एक दस्तावेज़ बनाते हैं, तो उन्हें merge-pdf से पढ़ने के क्रम में जोड़िए, सहेजने के क्रम में नहीं।

और आख़िर में। लंबे भंडारण के लिए नतीजे को pdf-to-pdfa से गुज़ारना सार्थक है: संग्रह प्रोफ़ाइल माँगती है कि दिखाने के लिए ज़रूरी सब कुछ फ़ाइल के भीतर ही हो, और संग्रह को ठीक यही चाहिए।

FAQ

नहीं, टूल फ़ाइल से काम करता है। पेज को ब्राउज़र में HTML के रूप में सहेजिए और नतीजा अपलोड कीजिए। वह सहेजने का विकल्प सबसे अच्छा काम करता है जो पूरे पेज को एक ही फ़ाइल में समेट देता है।
पेज अलग-थलग बनाया जाता है: स्थानीय फ़ाइलों तक पहुँच रोक दी जाती है, और बाहरी पतों में से सिर्फ़ वही चलते हैं जो स्थिर जाँच में HTML में दिखते हैं। पेज खुलने के बाद स्क्रिप्ट जो तस्वीरें लाती है, वे चित्रण तक पहुँचती ही नहीं।
यह स्वचालित तेज़ रास्ता है: बहुत बड़ी HTML फ़ाइलें, जिनमें तस्वीरें, तालिकाएँ, भीतर लिखी शैलियाँ और मीडिया नहीं होते, टेक्स्ट के रूप में बनती हैं। नतीजे के साथ चेतावनी आती है कि सजावट नहीं बची।
नहीं, बुनियादी काम बिना पंजीकरण के होता है।
फ़ाइलें केवल चुने गए ऑपरेशन के लिए उपयोग होती हैं और प्रोसेसिंग पूरी होते ही स्वतः हटा दी जाती हैं। हम अपलोड किए गए दस्तावेज़ों का उपयोग AI मॉडल के प्रशिक्षण के लिए नहीं करते।

इस क्लस्टर से और

सुरक्षा

PDF को password से कैसे protect करें

email से भेजने से पहले PDF को पासवर्ड से कैसे सुरक्षित करें और क्या ध्यान रखें ताकि आप खुद अपने दस्तावेज़ से बाहर न हो जाएँ या पहुँच न खो दें.

सुरक्षा

सुरक्षित PDF से पासवर्ड कैसे हटाएँ

PDF में सुरक्षा के दो तंत्र हैं, और उनमें से सिर्फ़ एक असली है। कूटबद्धता क्या देती है, नक़ल की रोक महज़ अनुरोध क्यों है, और ख़ाली पासवर्ड खाना कभी-कभी काम क्यों बना देता है।

सुरक्षा

PDF में संवेदनशील डेटा कैसे छिपाएं

टेक्स्ट के ऊपर खींचा गया काला आयत कुछ नहीं मिटाता। रिडैक्शन के स्टाइल में असल में क्या फ़र्क़ है, धुँधलाहट हटाना क्यों नहीं मानी जाती, और मेटाडेटा का क्या होता है।

संबंधित टूल

← रूपांतरण श्रेणी के सभी टूल

आगे क्या करें

अगर पढ़ने के बाद आपको अगला व्यावहारिक कदम या सेवा के बारे में और मार्गदर्शन चाहिए, तो ये पेज खोलें.

सभी टूल्स

PDF tools catalog: PDF merge, compress, split, convert, rotate, protect और unlock करें, सब कुछ सीधे आपके browser में.

अक्सर पूछे जाने वाले प्रश्न

iHatePDF के बारे में frequently asked questions के जवाब: क्या registration जरूरी है, files कैसे process होती हैं, limits कहाँ देखें और documents upload करना safe है या नहीं।

संपर्क

Processing errors, tool चुनने, safety, business queries और नए features के सुझावों के लिए iHatePDF से संपर्क करें।