मुख्य सामग्री पर जाएं
लेख

PDF में संवेदनशील डेटा कैसे छिपाएं

टेक्स्ट के ऊपर खींचा गया काला आयत कुछ नहीं मिटाता। रिडैक्शन के स्टाइल में असल में क्या फ़र्क़ है, धुँधलाहट हटाना क्यों नहीं मानी जाती, और मेटाडेटा का क्या होता है।

संक्षेप में: काला और सफ़ेद स्टाइल आयत के नीचे की सामग्री सचमुच काट देते हैं: ढका हुआ टेक्स्ट फ़ाइल से ग़ायब हो जाता है और बाक़ी पेज टेक्स्ट ही रहता है। धुँधलाहट सिर्फ़ छिपाती है और साथ ही पूरे दस्तावेज़ को तस्वीरों में बदल देती है। मेटाडेटा डिफ़ॉल्ट रूप से मिटाया जाता है।

क्लस्टर

सुरक्षा

सुरक्षा, पहुँच नियंत्रण, रेडैक्शन और नियंत्रित साझा करने के प्रवाह.

4 लेख

मुख्य टूल

रिएक्ट पीडीएफ ऑनलाइन

इस लेख वाला टूल खोलें और मौजूदा लोकैल में ऑपरेशन पूरा करें.

टूल खोलें

विषय-सूची

PDF में व्यक्तिगत डेटा ऐसे छिपाएँ कि वह वापस न निकाला जा सके

यह क़िस्सा साल में क़रीब एक बार दोहराता है और ख़बरों तक पहुँचता है। कोई संस्था ऐसा दस्तावेज़ प्रकाशित करती है जिसमें नाम और पते सलीक़े से काले आयतों से ढके होते हैं। एक घंटे बाद कोई माउस से टेक्स्ट चुनता है, नोटपैड में चिपकाता है और ढका हुआ सब कुछ पूरा पा लेता है।

कारण सीधा है, और उसे समझना बटन का क्रम याद रखने से ज़्यादा ज़रूरी है।

टेक्स्ट के ऊपर आयत कुछ क्यों नहीं छिपाता

PDF परतों से बनी होती है। टेक्स्ट पेज की सामग्री में टेक्स्ट के रूप में रहता है, निर्देशांक और फ़ॉन्ट के साथ। संपादक में उसके ऊपर खींचा आयत सामग्री का एक और तत्व है, जो बाद में बनता है और इसीलिए ऊपर दिखता है।

टेक्स्ट कहीं नहीं जाता। वह अब भी फ़ाइल में है, खोज से मिलता है, माउस से चुना जाता है और कॉपी होता है। आयत उसे सिर्फ़ आँख के लिए ढकता है, ठीक वैसे जैसे मॉनिटर पर रखा काग़ज़ का पन्ना।

असली रिडैक्शन दूसरी तरह चलता है: क्षेत्र के नीचे की सामग्री पहले पेज से काट दी जाती है, और उसके बाद ही ख़ाली हुई जगह पर भराव रखा जाता है।

तीन स्टाइल और हर एक सामग्री के साथ क्या करता है

स्टाइलसामग्री के साथ क्या होता हैदस्तावेज़ टेक्स्ट रहता है?
कालाक्षेत्र के नीचे की सामग्री मिट जाती है, ऊपर काला भरावहाँ, बाक़ी पेज टेक्स्ट रहता है
सफ़ेदवही, भराव सफ़ेदहाँ
धुँधलाहटदस्तावेज़ तस्वीरों में दोबारा बनता है, क्षेत्र धुँधला होता हैनहीं, टेक्स्ट लेयर पूरी चली जाती है

पहले दो असली हटाना हैं। ऐसे दस्तावेज़ पर जाँचा गया जहाँ संदर्भ संख्या वाली पंक्ति काले क्षेत्र से ढकी गई: प्रोसेसिंग के बाद वह पंक्ति न खोज से मिलती है न कॉपी से, जबकि पड़ोसी पंक्तियाँ सामान्य टेक्स्ट की तरह चुनी जाती रहती हैं।

धुँधलाहट छिपाती है, हटाती नहीं

तीसरा स्टाइल अलग खड़ा है, और उसकी दो क़ीमतें हैं।

पहली: वह हटाता नहीं। धुँधलाहट क्षेत्र की तस्वीर बिगाड़ती है, पर उसमें मौजूद जानकारी प्रोसेसिंग से आंशिक रूप से वापस पाई जा सकती है। व्यक्तिगत डेटा के लिए यह अस्वीकार्य है, और टूल यह सीधे कहता है: धुँधलाहट चुनने पर नतीजे के साथ काला या सफ़ेद स्टाइल लेने की सलाह वाली चेतावनी जुड़ जाती है।

दूसरी क़ीमत बाइट और सुविधाओं में नापी जाती है। धुँधलाहट एक क्षेत्र पर नहीं, पूरे दस्तावेज़ की रास्टर प्रति पर काम करती है। बीस पंक्तियों वाली एक पेज की परीक्षण फ़ाइल क़रीब एक किलोबाइट की थी। काले रिडैक्शन के बाद वह वही एक किलोबाइट रही। धुँधलाहट के बाद वह नब्बे तक पहुँच गई और टेक्स्ट लेयर पूरी खो बैठी: ऐसे दस्तावेज़ में खोजा नहीं जा सकता।

धुँधलाहट का अर्थ ठीक एक हालत में है: किसी तस्वीर में चेहरा या छवि का ऐसा हिस्सा छिपाना जहाँ काट देने से बेतुका काला छेद बन जाता।

रिडैक्शन कैसे करें

1. redact-pdf खोलिए और दस्तावेज़ अपलोड कीजिए। 2. क्षेत्र सीधे पेज पर चिह्नित कीजिए: टूल दस्तावेज़ दिखाता है और मनचाही जगहों को घेरने देता है। 3. स्टाइल चुनिए। डेटा के लिए काला या सफ़ेद। 4. मेटाडेटा हटाना चालू रहने दीजिए। 5. प्रोसेस चलाइए। 6. नतीजा खोलकर ढकी हुई जगह माउस से चुनने की कोशिश कीजिए, और फिर दस्तावेज़ में हटाया गया शब्द खोजिए।

छठा बिंदु औपचारिकता नहीं है। यही अकेली जाँच असली हटाने को खींचे हुए आयत से अलग करती है, और उसमें दस सेकंड लगते हैं।

क्षेत्र बताना अनिवार्य है

टूल अंदाज़ा नहीं लगाता कि क्या छिपाना है। बिना बताए क्षेत्र के काम शुरू ही नहीं होता और सीधा संदेश लौटता है कि कम से कम एक क्षेत्र चाहिए।

यह जानबूझकर लिया गया और सही फ़ैसला है। जिस काम में ग़लती का मतलब व्यक्तिगत डेटा का रिसाव हो, वहाँ क्षेत्र का अंदाज़ा इनकार से ज़्यादा ख़तरनाक है: ग़लत जगह ढककर टूल सफलता की सूचना देता, और डेटा खुला रह जाता।

इसी कारण क्षेत्रों की जाँच होती है: पेज के बाहर के निर्देशांक या शून्य चौड़ाई त्रुटि देते हैं, चुपचाप छोड़े नहीं जाते।

मेटाडेटा डिफ़ॉल्ट रूप से मिटता है

एक अलग स्विच दस्तावेज़ के गुणों की सफ़ाई संभालता है, और वह डिफ़ॉल्ट रूप से चालू है।

यह छोटी बात नहीं। गुणों में नियमित रूप से दस्तावेज़ तैयार करने वाले कर्मचारी का नाम, भीतरी काम-चलाऊ शीर्षक, कभी किसी डिस्क का फ़ोल्डर पथ मिलता है। जिस दस्तावेज़ से ग्राहक का उपनाम सावधानी से काटा गया, पर गुणों में लेखक का नाम और «इवानोव का मामला, ड्राफ़्ट» जैसा शीर्षक रह गया, वह काम पूरा नहीं करता।

सफ़ाई बंद करने पर अलग चेतावनी आती है: मूल मेटाडेटा बचा रहा है और उसमें लोगों की पहचान कराने वाली जानकारी हो सकती है। यह चुपचाप नहीं होता।

गुणों पर बारीक़ काम के लिए set-pdf-metadata है, जहाँ खाने सिर्फ़ ख़ाली ही नहीं होते, मनचाहे मान से भरे भी जाते हैं।

रिडैक्शन हुआ, इसका निशान

पैरामीटर में एक खाना है छोटी टिप्पणी के लिए, जो तैयार फ़ाइल के गुणों में, विषय वाले खाने में लिखी जाती है।

इसका उद्देश्य कार्यालयी है: प्राप्तकर्ता देखता है कि दस्तावेज़ जानबूझकर संपादित हुआ है, ख़राब होकर नहीं आया। «व्यक्तिगत डेटा हटाया गया» या «अमुक धारा के अनुसार रोका गया» जैसी पंक्तियाँ पत्राचार का एक चक्कर बचा देती हैं।

लंबाई पाँच सौ अक्षरों तक सीमित है। इससे लंबा पाठ काट दिया जाता है और चेतावनी आ जाती है, यानी टिप्पणी चुपचाप ग़ायब नहीं होती, पर पूरी भी नहीं पहुँचती।

मुख्य पाठ के अलावा डेटा कहाँ छिपा होता है

पूरे दस्तावेज़ का चक्कर याद से नहीं, सूची से लगाना बेहतर है। भूली जाने वाली जगहें दस्तावेज़ दर दस्तावेज़ दोहराती हैं।

शीर्ष और पाद पंक्तियाँ। वे हर पेज पर दोहराती हैं, और अगर उनमें उपनाम या मामले की संख्या है तो सभी पेज ढकने होंगे, सिर्फ़ पहला नहीं।

हस्ताक्षर और मुहरें। हस्ताक्षर व्यक्तिगत डेटा है और स्कैन पर पूरा दिखता है। मुहर में संस्था का नाम और अक्सर पता होता है।

अनुलग्नकों की तालिकाएँ। मुख्य पाठ ध्यान से पढ़ा जाता है, अनुलग्नक पलट दिए जाते हैं, और नाम-फ़ोन की सूचियाँ अनुलग्नकों में ही होती हैं।

पिछले पन्ने। दोतरफ़ा स्कैन में पिछले पन्ने सामने वालों के बीच आते हैं, और आधे ख़ाली लगते हैं क्योंकि थंबनेल पर टेक्स्ट की सिर्फ़ छाया दिखती है।

हाशिये की टिप्पणियाँ। हाथ से लिखे आदेश, पंजीकरण मुहरें, संख्या वाले स्टिकर।

एक व्यावहारिक तरक़ीब: शुरू करने से पहले दस्तावेज़ खोलकर उसमें उपनाम, फ़ोन नंबर और पता खोज लीजिए। खोज हर उपस्थिति दिखा देती है, उन्हें भी जिन्हें आँख छोड़ देती है।

टूल क्या नहीं करता

वह आपके लिए व्यक्तिगत डेटा नहीं ढूँढ़ता। टूल वही हटाता है जो आपने घेरा, और कुछ नहीं। पूरे दस्तावेज़ का चक्कर लगाने की ज़िम्मेदारी इंसान की ही रहती है।

इससे व्यावहारिक नियम बनता है: दस्तावेज़ पूरा देखिए, शीर्ष-पाद पंक्तियाँ, तालिकाओं के नीचे के शीर्षक और पिछले पन्ने समेत। डेटा ठीक वहीं भूला जाता है, क्योंकि ध्यान मुख्य पाठ पर रहता है।

और अलग से: crop-pdf से पेज काटना रिडैक्शन नहीं है। वह शीट का दिखने वाला हिस्सा बदलता है, जबकि उसके बाहर की सामग्री फ़ाइल में रहती है और कटाई हटाते ही लौट आती है।

अगर दस्तावेज़ स्कैन है, तो क्षेत्र के नीचे शायद टेक्स्ट हो ही नहीं और काटने को कुछ न हो; वहाँ बस तस्वीर है। ऐसे में नतीजा दूसरे कारण से भरोसेमंद है: तस्वीर का एक टुकड़ा हट जाता है। पर अगर स्कैन इससे पहले ocr-pdf से गुज़रा है, तो तस्वीर के नीचे टेक्स्ट लेयर बन चुकी है, और उसे भी क्षेत्र से ढकना होगा।

FAQ

टेक्स्ट के ऊपर खींचा आयत अलग परत है, और टेक्स्ट नीचे बना रहता है, कॉपी या खोज से मिल जाता है। यहाँ के काले और सफ़ेद स्टाइल सामग्री को फ़ाइल से मिटाते हैं और भराव अब ख़ाली हुई जगह पर लगाते हैं।
नहीं। धुँधलाहट तस्वीर बिगाड़ती है, हटाती नहीं, और सामग्री का कुछ हिस्सा प्रोसेसिंग से वापस मिल जाता है। यह स्टाइल चुनते ही टूल साफ़ चेतावनी देता है। असली हटाने के लिए काला या सफ़ेद चाहिए।
काले और सफ़ेद के साथ हाँ: बिना ढका टेक्स्ट टेक्स्ट ही रहता है और फ़ाइल का आकार लगभग नहीं बदलता। धुँधलाहट के साथ नहीं: पूरा दस्तावेज़ तस्वीरों के रूप में दोबारा बनता है और टेक्स्ट लेयर पूरी तरह चली जाती है।
नहीं, बुनियादी काम बिना पंजीकरण के होता है।
फ़ाइलें केवल चुने गए ऑपरेशन के लिए उपयोग होती हैं और प्रोसेसिंग पूरी होते ही स्वतः हटा दी जाती हैं। हम अपलोड किए गए दस्तावेज़ों का उपयोग AI मॉडल के प्रशिक्षण के लिए नहीं करते।

इस क्लस्टर से और

सुरक्षा

PDF को password से कैसे protect करें

email से भेजने से पहले PDF को पासवर्ड से कैसे सुरक्षित करें और क्या ध्यान रखें ताकि आप खुद अपने दस्तावेज़ से बाहर न हो जाएँ या पहुँच न खो दें.

सुरक्षा

सुरक्षित PDF से पासवर्ड कैसे हटाएँ

PDF में सुरक्षा के दो तंत्र हैं, और उनमें से सिर्फ़ एक असली है। कूटबद्धता क्या देती है, नक़ल की रोक महज़ अनुरोध क्यों है, और ख़ाली पासवर्ड खाना कभी-कभी काम क्यों बना देता है।

सुरक्षा

HTML से PDF: वेब पेज सेव करें

टूल पेज का पता नहीं, सहेजी हुई HTML फ़ाइल लेता है और उसे अलग-थलग ब्राउज़र में बनाता है। इसीलिए नियम बनते हैं: स्थानीय तस्वीरें नहीं आतीं, और लोड होने के बाद जो कुछ आता है वह PDF तक कभी नहीं पहुँचता।

संबंधित टूल

रिएक्ट पीडीएफ ऑनलाइन

PDF में निजी और गोपनीय अंश पूरी तरह ढकें, रिडैक्शन लागू करें और साझा करने से पहले डाउनलोड की गई प्रति जाँचें। एक उपयोगी उदाहरण है: पहचान पत्र, विवरण या अनुबंध से अनावश्यक निजी डेटा हटाना.

PDF क्रॉप करें ऑनलाइन

चौड़े मार्जिन, scan के गहरे किनारे या अतिरिक्त जगह हटाने के लिए PDF पेजों का दृश्य क्षेत्र क्रॉप करें.

PDF मेटाडेटा सेट करें

PDF के मेटाडेटा - शीर्षक, लेखक, विषय और keywords - सेट या बदलें ताकि documents आसानी से व्यवस्थित हों.

ओसीआर पीडीएफ ऑनलाइन

ओसीआर पीडीएफ PDF कार्य को एक ही ब्राउज़र प्रवाह में रखता है: स्रोत फ़ाइल अपलोड करें, विकल्प देखें, प्रक्रिया चलाएँ और परिणाम डाउनलोड करें.

← सुरक्षा श्रेणी के सभी टूल

आगे क्या करें

अगर पढ़ने के बाद आपको अगला व्यावहारिक कदम या सेवा के बारे में और मार्गदर्शन चाहिए, तो ये पेज खोलें.

सभी टूल्स

PDF tools catalog: PDF merge, compress, split, convert, rotate, protect और unlock करें, सब कुछ सीधे आपके browser में.

अक्सर पूछे जाने वाले प्रश्न

iHatePDF के बारे में frequently asked questions के जवाब: क्या registration जरूरी है, files कैसे process होती हैं, limits कहाँ देखें और documents upload करना safe है या नहीं।

संपर्क

Processing errors, tool चुनने, safety, business queries और नए features के सुझावों के लिए iHatePDF से संपर्क करें।