HTML से PDF: वेब पेज सेव करें
संक्षेप में: पेज को बिना इंटरफ़ेस वाला ब्राउज़र आपकी अपलोड की HTML फ़ाइल से बनाता है। स्थानीय पथ बिल्कुल नहीं माँगे जाते, और बाहरी पते सिर्फ़ वही जो ख़ुद HTML में दिखते हैं। भरोसेमंद संग्रह एक ही आत्मनिर्भर फ़ाइल से बनता है जिसमें सब कुछ भीतर समाया हो।
क्लस्टर
सुरक्षा
सुरक्षा, पहुँच नियंत्रण, रेडैक्शन और नियंत्रित साझा करने के प्रवाह.
मुख्य टूल
HTML से PDF ऑनलाइन
इस लेख वाला टूल खोलें और मौजूदा लोकैल में ऑपरेशन पूरा करें.
टूल खोलेंविषय-सूची
- टूल फ़ाइल लेता है, पेज का पता नहीं
- तस्वीरें क्यों ग़ायब हो जाती हैं
- लोड होने के बाद जो आता है, वह PDF तक नहीं पहुँचता
- PDF संग्रह स्क्रीनशॉट और बुकमार्क से कैसे अलग है
- सहेजना कैसे करें
- पृष्ठभूमि ग्राफ़िक और उसे चालू क्यों रखें
- पेज का आकार और चौड़ी तालिकाएँ
- HTML कब सादा टेक्स्ट बन जाता है
- तैयार संग्रह का क्या करें
वेब पेज को PDF में सहेजना: संग्रह में क्या पहुँचता है और क्या नहीं
पेज ऐसे रखना है कि एक साल बाद वह खुले और आज जैसा ही दिखे: सेवा की शर्तें, शुल्क का पन्ना, ऐसा लेख जिसे कोई संपादित कर सकता है। इसके लिए PDF स्क्रीनशॉट से बेहतर है, क्योंकि टेक्स्ट बचा रहता है, और बुकमार्क से बेहतर है, क्योंकि वह पराए सर्वर पर निर्भर नहीं।
पर «ब्राउज़र में पेज» और «PDF में पेज» के बीच कुछ क़दम हैं जहाँ सामग्री खो जाती है। देखते हैं कहाँ।
टूल फ़ाइल लेता है, पेज का पता नहीं
पहली समझने लायक़ बात: इसमें किसी साइट का पता नहीं लिखा जाता। सहेजी हुई HTML फ़ाइल अपलोड की जाती है।
पेज सहेजना ब्राउज़र जानता है। सहेजने के संवाद में आम तौर पर «सिर्फ़ HTML» और पूरे पेज को समेटने वाले विकल्प के बीच चुनाव होता है। दूसरा विकल्प साफ़ तौर पर बेहतर है: वह मार्कअप, शैलियाँ और तस्वीरें एक फ़ाइल में इकट्ठा कर देता है, और संग्रह को यही चाहिए।
ऐसा क्यों बना है, यह अगला हिस्सा समझाता है, और वही व्याख्या अधिकांश अप्रत्याशित नतीजों को भी ढक लेती है।
तस्वीरें क्यों ग़ायब हो जाती हैं
पेज अलग-थलग ब्राउज़र में बनाया जाता है, और सामग्री उसे सीधे सौंपी जाती है, फ़ाइल पथ से खोली नहीं जाती। ऐसे पेज की डिस्क पर कोई जगह नहीं होती जहाँ से वह पड़ोसी फ़ाइलें पढ़ सके।
इससे सख़्त नियम बनता है: स्थानीय फ़ाइलों के संदर्भ काम नहीं करते। अगर आपकी `page.html` के बगल में तस्वीरों से भरा `page_files` फ़ोल्डर है, तो उनमें से एक भी PDF तक नहीं पहुँचेगी। ब्राउज़र उन तक पहुँच ही नहीं सकता।
बाहरी पते चलते हैं, पर कोई भी नहीं। चित्रण से पहले HTML की स्थिर जाँच होती है, उससे पतों की सूची बनती है, और सिर्फ़ वही लाए जाते हैं। जिस संसाधन के बारे में मार्कअप कुछ नहीं कहता, वह रोक दिया जाता है, और किसी दूसरे पते पर पुनर्निर्देशन भी।
एक व्यावहारिक निष्कर्ष निकलता है: भरोसेमंद संग्रह उसी आत्मनिर्भर फ़ाइल से बनता है जिसमें तस्वीरें और शैलियाँ मार्कअप के भीतर समाई हों, बगल में पड़ी न हों।
लोड होने के बाद जो आता है, वह PDF तक नहीं पहुँचता
नुक़सान का दूसरा स्रोत गतिशीलता है।
आजकल का पेज अक्सर खुलने के बाद सामग्री लाता है: स्क्रॉल करते-करते तस्वीरें, क्लिक पर टिप्पणियाँ, अलग अनुरोध से आँकड़ों की तालिका। चित्रण मार्कअप पर काम करता है, जीवित पेज पर नहीं, और जो बाद में लोड होता है वह उसमें है ही नहीं।
इसी कारण मुड़े हुए ब्लॉक मुड़े ही रहते हैं, सक्रिय के अलावा बाक़ी टैब ग़ायब रहते हैं, और माउस ले जाने पर दिखने वाला सब कुछ नहीं आता।
आप पहले से जाँच सकते हैं: ब्राउज़र में स्क्रिप्ट बंद कीजिए और पेज दोबारा लोड कीजिए। जो दिखता रह जाए वह PDF तक पहुँचेगा। जो ग़ायब हो जाए, नहीं।
PDF संग्रह स्क्रीनशॉट और बुकमार्क से कैसे अलग है
पेज सहेजने के तीन तरीक़े अलग-अलग समस्याएँ हल करते हैं, और उन्हें मिला देना महँगा पड़ता है।
| तरीक़ा | क्या बचता है | क्या नहीं होता |
|---|---|---|
| बुकमार्क | पते के सिवा कुछ नहीं | पेज बदल सकता है या हट सकता है |
| स्क्रीनशॉट | दिखने वाले हिस्से की तस्वीर | टेक्स्ट न खोजा जा सकता है न कॉपी, लंबा पेज समाता नहीं |
| टेक्स्ट, सजावट, सभी पेज पूरे | अंतःक्रिया और स्क्रिप्ट से आने वाला सब |
प्रमाण के काम में दूसरी पंक्ति का तीसरा स्तंभ मायने रखता है। शुल्क पन्ने का स्क्रीनशॉट खोज से कोई खंड नहीं ढूँढ़ने देता और यह नहीं दिखाता कि नीचे क्या था। PDF दोनों कर देती है।
अलग से याद रखने लायक़: इन तीनों में से कोई भी किसी तिथि पर पेज की सामग्री का क़ानूनी प्रमाण नहीं है। उसके लिए नोटरी प्रमाणन होता है, और वह अलग ढंग से काम करता है।
सहेजना कैसे करें
1. पेज ब्राउज़र में खोलिए और एक-फ़ाइल विकल्प चुनकर HTML के रूप में सहेजिए। 2. html-to-pdf खोलिए और सहेजी फ़ाइल अपलोड कीजिए। 3. पेज का आकार चुनिए: A4 या Letter। 4. सजावट मायने रखती हो तो पृष्ठभूमि ग्राफ़िक चालू रहने दीजिए। 5. प्रोसेस चलाइए और नतीजे की मूल पेज से तुलना कीजिए।
पाँचवाँ क़दम तुरंत कीजिए, महीने भर बाद नहीं: कुछ खो गया हो तो पेज अभी उपलब्ध है और उसे दूसरे तरीक़े से सहेजा जा सकता है।
पृष्ठभूमि ग्राफ़िक और उसे चालू क्यों रखें
पृष्ठभूमि ग्राफ़िक का स्विच तय करता है कि भराव, पृष्ठभूमि तस्वीरें और रंगीन पट्टियाँ PDF तक पहुँचें या नहीं।
यह डिफ़ॉल्ट रूप से चालू है, और संग्रह के लिए यही सही है: बंद होने पर रंगीन पट्टी पर लिखा टेक्स्ट सफ़ेद पर लिखा टेक्स्ट बन जाता है, और सजावट का कुछ अर्थ खो जाता है। यह ख़ासकर रंग से चिह्नित चेतावनियों और बारी-बारी रंग वाली पंक्तियों की तालिकाओं में दिखता है।
इसे बंद करने की ठीक एक वजह है: पेज छपाई में जा रहा है और भराव टोनर खा जाएगा। संग्रह के लिए चालू ही रखिए।
पेज का आकार और चौड़ी तालिकाएँ
पेज का आकार डिफ़ॉल्ट रूप से A4 है। यहाँ चुनाव सिर्फ़ A4 और Letter के बीच है; मनचाहा फ़ॉर्मैट नहीं।
इससे एक अटल समस्या निकलती है। वेब पेज की कोई चौड़ाई नहीं होती: वह खिड़की के हिसाब से ढल जाता है। PDF की चौड़ाई तय होती है। जो चौड़ी तालिका ब्राउज़र में बग़ल में सरकती थी, वह PDF में शीट के किनारे पर कट जाएगी।
टूल के भीतर इसका कोई रास्ता नहीं। बाहर से निकाला जाता है: सहेजने से पहले ब्राउज़र में पेज का ज़ूम घटा दीजिए, तब तालिका चौड़ाई में समा जाएगी।
HTML कब सादा टेक्स्ट बन जाता है
एक स्वचालित तेज़ रास्ता है। बहुत बड़ी HTML फ़ाइलें, जिनमें न तस्वीरें हैं, न तालिकाएँ, न भीतर लिखी शैलियाँ, न मीडिया, सादे टेक्स्ट के रूप में बनती हैं, बिना किसी विन्यास के।
यह जानबूझकर लिया गया फ़ैसला है: कई मेगाबाइट के शुद्ध टेक्स्ट वाले पेज को पूरा चित्रित करना महँगा है और नतीजा वही देता है।
यह चुपचाप नहीं होता। नतीजे के साथ चेतावनी आती है कि दस्तावेज़ सरलीकृत रूप में बना और सजावट नहीं बची। यह नतीजा आपके काम का न हो तो फ़ाइल ग़लती से इस नियम में आ गई, और पेज को ऐसे दोबारा सहेजना चाहिए कि उसका मार्कअप बना रहे।
तैयार संग्रह का क्या करें
तीन क़दम जो तुरंत करने लायक़ हैं।
वज़न जाँचिए। तस्वीरों से भरा पेज भारी PDF देता है, और compress-pdf उसे टेक्स्ट छुए बिना घटा देगा।
दस्तावेज़ के गुण भरिए। HTML से बनी PDF में शीर्षक का खाना आम तौर पर ख़ाली रहता है या उसमें कोई तकनीकी पंक्ति होती है। set-pdf-metadata से सार्थक शीर्षक और तारीख़ एक साल बाद संग्रह में खोज बहुत आसान कर देते हैं।
अगर कई पेज मिलकर एक दस्तावेज़ बनाते हैं, तो उन्हें merge-pdf से पढ़ने के क्रम में जोड़िए, सहेजने के क्रम में नहीं।
और आख़िर में। लंबे भंडारण के लिए नतीजे को pdf-to-pdfa से गुज़ारना सार्थक है: संग्रह प्रोफ़ाइल माँगती है कि दिखाने के लिए ज़रूरी सब कुछ फ़ाइल के भीतर ही हो, और संग्रह को ठीक यही चाहिए।
FAQ
इस क्लस्टर से और
सुरक्षा
PDF को password से कैसे protect करें
email से भेजने से पहले PDF को पासवर्ड से कैसे सुरक्षित करें और क्या ध्यान रखें ताकि आप खुद अपने दस्तावेज़ से बाहर न हो जाएँ या पहुँच न खो दें.
सुरक्षा
सुरक्षित PDF से पासवर्ड कैसे हटाएँ
PDF में सुरक्षा के दो तंत्र हैं, और उनमें से सिर्फ़ एक असली है। कूटबद्धता क्या देती है, नक़ल की रोक महज़ अनुरोध क्यों है, और ख़ाली पासवर्ड खाना कभी-कभी काम क्यों बना देता है।
सुरक्षा
PDF में संवेदनशील डेटा कैसे छिपाएं
टेक्स्ट के ऊपर खींचा गया काला आयत कुछ नहीं मिटाता। रिडैक्शन के स्टाइल में असल में क्या फ़र्क़ है, धुँधलाहट हटाना क्यों नहीं मानी जाती, और मेटाडेटा का क्या होता है।
संबंधित टूल
HTML से PDF ऑनलाइन
HTML पेज को PDF में बदलें ताकि उसकी सामग्री archive या भेजने के लिए document के रूप में सहेजी जाए.
PDF कंप्रेस करें ऑनलाइन
PDF file का size कम करें ताकि उसे email, upload या store करना आसान हो. यह scans और images वाले documents के लिए खास उपयोगी है.
PDF मर्ज करें ऑनलाइन
कई PDF को एक file में मर्ज करें: attachments वाला contract, पहचान दस्तावेज़ों के scans का ढेर, या report के हिस्से, जिन्हें दस अलग emails में भेजने से एक ही attachment में भेजना आसान होता है.
PDF से PDF/A ऑनलाइन
सामान्य PDF को PDF/A में बदलें, जो भरोसेमंद दीर्घकालिक भंडारण के लिए बना format है.
आगे क्या करें
सभी टूल्स
PDF tools catalog: PDF merge, compress, split, convert, rotate, protect और unlock करें, सब कुछ सीधे आपके browser में.
अक्सर पूछे जाने वाले प्रश्न
iHatePDF के बारे में frequently asked questions के जवाब: क्या registration जरूरी है, files कैसे process होती हैं, limits कहाँ देखें और documents upload करना safe है या नहीं।
संपर्क
Processing errors, tool चुनने, safety, business queries और नए features के सुझावों के लिए iHatePDF से संपर्क करें।