मुख्य सामग्री पर जाएं
लेख

PDF को PDF/A में कैसे बदलें

साधारण PDF को संग्रह के लिए PDF/A में बदलें: कौन-सा स्तर चुनें, फ़ॉन्ट और रंग प्रोफ़ाइल कैसे एम्बेड करें, और कैसे जाँचें कि फ़ाइल दस साल बाद भी खुलेगी।

संक्षेप में: संग्रह के लिए PDF को pdf-to-pdfa से PDF/A में बदलें. सभी फ़ॉन्ट और रंग प्रोफ़ाइल फ़ाइल के अंदर एम्बेड हो जाते हैं, इसलिए वह सालों बाद भी एक जैसी खुलती है. ज़्यादातर मामलों में PDF/A-2b चुनें; स्कैन में खोज चाहिए तो पहले OCR चलाएँ.

क्लस्टर

सर्वोत्तम अभ्यास

दोहराए जाने वाले PDF काम और गुणवत्ता-नियंत्रण के लिए स्थिर ऑपरेशनल पैटर्न.

5 लेख

मुख्य टूल

PDF से PDF/A ऑनलाइन

इस लेख वाला टूल खोलें और मौजूदा लोकैल में ऑपरेशन पूरा करें.

टूल खोलें

विषय-सूची

Archive के लिए PDF को PDF/A में कैसे बदलें

Document को PDF/A में जमा करने की शर्त वहाँ आती है जहाँ फ़ाइल को अपने ही software से ज़्यादा जीना होता है: सरकारी archives, अदालती systems, शोध-प्रबंध जमा करने और लंबी अवधि तक रखे जाने वाले corporate documents में.

Format का मक़सद आत्मनिर्भरता है. आम PDF system में लगे किसी font का हवाला दे सकता है या monitor के colour profile पर टिका हो सकता है. बीस साल बाद शायद दोनों में से कुछ भी न हो, और document वह नहीं खुलेगा जो वह था. PDF/A ऐसी बाहरी निर्भरताएँ मना करता है: सब ज़रूरी चीज़ फ़ाइल के भीतर रहती है.

Conversion में होता क्या है

बदलाव Ghostscript करता है, और यह metadata का ऊपरी सुधार नहीं है.

Fonts पूरे के पूरे फ़ाइल में समाहित कर दिए जाते हैं, ताकि document इस पर निर्भर न रहे कि पढ़ने वाले की मशीन पर क्या लगा है. रंग एक वर्णित profile पर लाए जाते हैं, और फ़ाइल के साथ output colour profile जोड़ा जाता है, जिससे बाद में साफ़ पता चलता है कि कौन सी छाया इच्छित थी. Metadata में conformance level की घोषणा लिखी जाती है.

इससे यह निकलता है कि conversion के बाद फ़ाइल लगभग हमेशा मूल से भारी हो जाती है. समाहित fonts और colour profile जगह लेते हैं. यह सामान्य है और आत्मनिर्भरता की क़ीमत है, यह संकेत नहीं कि कुछ ग़लत हुआ.

कौन सा level चुनें

Levels तीन हैं, default में बीच वाला.

Levelकिस पर आधारितख़ासियत
PDF/A-1bपुराने PDF 1.4 परसबसे सख़्त पाबंदियाँ, submission systems के साथ अधिकतम मेल
PDF/A-2bPDF 1.7समझदार संतुलन, ज़्यादातर requirements के लिए ठीक
PDF/A-3bPDF 1.72b जैसा ही, साथ में कोई भी फ़ाइल जोड़ने की छूट

तीनों में b का मतलब basic level है: गारंटी यह कि document हमेशा एक जैसा दिखेगा. एक level a भी है, structure और accessibility की शर्तों के साथ, पर वह मूल document से इतना माँगता है कि आम scanned certificate की automatic conversion उस तक नहीं पहुँचती.

अगर archive की requirements में level सीधे नाम से दिया है, तो वही लीजिए. अगर सिर्फ़ «PDF/A» लिखा है, तो 2b लीजिए. पहला level सोच-समझकर चुनना चाहिए: वह PDF के पुराने version पर टिका है और transparency तथा layers नहीं संभालता, इसलिए आधुनिक graphics वाला document 1b में बदलने पर ज़्यादा बदलता है.

Service अपना ही नतीजा जाँचती है

यह अलग से कहना ज़रूरी है, क्योंकि हर converter ऐसा नहीं करता.

बदलाव के बाद फ़ाइल में PDF/A के अनिवार्य निशान जाँचे जाते हैं: क्या conformance level metadata में घोषित है और क्या वह माँगे गए level से मेल खाता है. नतीजे को सिर्फ़ इसलिए conformant घोषित नहीं किया जाता कि conversion बिना error पूरी हो गई.

अगर जाँच पास नहीं होती, तो फ़ाइल फिर भी दी जाती है, पर ईमानदारी से, आम PDF के रूप में और इस स्पष्टीकरण के साथ कि क्या कमी रही. वह आम तौर पर मूल से बेहतर ही रहती है, बस उसे PDF/A कहना झूठ होता. Metadata में झूठ भी नहीं लिखा जाता: जो फ़ाइल जाँच में पास नहीं हुई उस पर conformance के निशान नहीं लगाए जाते, क्योंकि ऐसा निशान इंसान और submission system दोनों को गुमराह करता.

यह जाँच क्या नहीं है

यहाँ गारंटी को बढ़ा-चढ़ाकर न आँकना ज़रूरी है.

जाँच format के निशान देखती है, ISO 19005 के अनुसार पूरी औपचारिक validation नहीं करती. पूरी validation के लिए अलग tool चाहिए, और उनमें मान्यता प्राप्त veraPDF है. फ़र्क़ बड़ा है: निशान यह पुष्टि करते हैं कि फ़ाइल ख़ुद को PDF/A बताती है और उसी हिसाब से बनी है, जबकि औपचारिक validation norm की हर शर्त बिंदु दर बिंदु जाँचती है.

आंतरिक archive और ज़्यादातर संस्थाओं के लिए पहला काफ़ी है. पर अगर document वहाँ जा रहा है जहाँ ग़ैर-अनुरूपता के क़ानूनी नतीजे होते हैं, तो तैयार फ़ाइल को अलग से veraPDF से गुज़ार दीजिए. इसी बात की चेतावनी service ख़ुद नतीजे के साथ आने वाले message में देती है.

क़दम दर क़दम

1. लेने वाले की requirements में देखिए कि कौन सा level चाहिए. 2. pdf-to-pdfa खोलिए और document अपलोड कीजिए. 3. Conformance level चुनिए, default 2b. 4. Document का सार्थक title दीजिए: वह archival metadata में जाएगा और उसी से फ़ाइल ढूँढ़ी जाएगी. 5. Conversion चलाइए और नतीजे का message पढ़िए, सिर्फ़ फ़ाइल डाउनलोड करके मत छोड़िए.

पाँचवाँ क़दम औपचारिकता नहीं है. उसी message में लिखा होता है कि conformance की पुष्टि हुई या फ़ाइल आम PDF बनकर लौटी.

Archive फिर भी फ़ाइल क्यों ठुकरा सकता है

Format के अनुरूप होना और किसी ख़ास archive में स्वीकार होना दो अलग बातें हैं, और दूसरी ज़्यादा सख़्त है.

सबसे ज़्यादा बार वजह वे शर्तें होती हैं जो ख़ुद norm में हैं ही नहीं. Archive कोई ख़ास level माँग सकता है, फ़ाइल का नाम रखने का तय तरीक़ा, metadata के अनिवार्य fields का समूह, या आकार की सीमा. फ़ाइल बेदाग़ PDF/A होगी और फिर भी लौट आएगी.

दूसरी आम वजह यह है कि document औपचारिक रूप से format के अनुरूप है पर उसमें वह नहीं है जिसके लिए उसे जमा किया जाता है. Text layer के बिना scan, PDF/A में बदलकर भी तस्वीरों का समूह ही रहता है. «खोजने योग्य PDF/A» की शर्त ऐसी फ़ाइल पूरी नहीं करती, भले ही format के बारे में दोनों शब्द सही हों.

तीसरी वजह कम दिखने वाली है: हो सकता है conformance की पुष्टि हुई ही न हो और किसी ने ध्यान न दिया हो. फ़ाइल डाउनलोड की, देखा कि खुल रही है, और भेज दी. उधर नतीजे का message कह रहा था कि जाँच पास नहीं हुई और फ़ाइल आम PDF बनकर लौट रही है. इसीलिए उसे पढ़ना चाहिए.

अगर archive की requirements कई पेजों का document हैं, तो पूरे संग्रह को बदलकर एक महीने बाद ग़ैर-अनुरूपता का पता चलने से बेहतर है एक बार test फ़ाइल पूरी शृंखला से गुज़ारकर उनसे पुष्टि ले लेना.

पहले से क्या तैयार करें

Conversion उसी के साथ काम करती है जो उसे दिया गया, मूल document की समस्याएँ नहीं सुधारती.

Scan किया हुआ document तस्वीरों का समूह ही रहेगा. औपचारिक रूप से वह PDF/A बन जाएगा, पर उसमें text खोजा नहीं जा सकेगा. अगर archive text layer वाला document चाहता है, तो scan को पहले ocr-pdf से गुज़ारिए और तब convert कीजिए.

Password वाला document तब तक convert नहीं होगा जब तक खोलने की protection न हटे. यह unlock-pdf से होता है. साथ ही याद रखिए कि PDF/A और encryption ख़ुद norm के अनुसार असंगत हैं: archival document बिना key खुलना चाहिए.

Title और बाक़ी properties conversion से पहले set-pdf-metadata से ठीक कर लेना आसान है, बजाय इसके कि बाद में उस फ़ाइल को सुधारें जो पहले ही archival घोषित हो चुकी है.

अगर documents बहुत हैं, तो उन्हें आँख मूँदकर एक साथ मत चलाइए. Conformance level और मूल फ़ाइलों की तैयारी document के प्रकार से बदलती है: scans को recognition चाहिए, transparency वाले documents पहले level में ठीक नहीं बैठते, password वाली फ़ाइलें बिल्कुल पास नहीं होतीं. समझदारी इसमें है कि संग्रह को प्रकार से बाँटिए, हर प्रकार के एक नमूने पर settings तय कीजिए और तभी बाक़ी चलाइए.

FAQ

PDF/A, PDF का ही एक हिस्सा है जो किसी बाहरी फ़ाइल पर निर्भर नहीं रहता: सभी फ़ॉन्ट अंदर एम्बेड होते हैं, रंग प्रोफ़ाइल फ़ाइल के भीतर ही रहती है, और JavaScript, एन्क्रिप्शन व बाहरी लिंक की अनुमति नहीं होती। ऐसी फ़ाइल कई साल बाद भी हर जगह एक जैसी खुलती है।
ज़्यादातर संग्रहों के लिए PDF/A-2b ठीक रहता है। यह पारदर्शिता, लेयर और JPEG2000 कम्प्रेशन को सहारा देता है। PDF/A-1b तभी लें जब कोई नियम या प्राप्तकर्ता सिस्टम इसकी माँग करे। PDF/A-3 तब चाहिए जब अंदर मूल स्रोत फ़ाइल भी रखनी हो, जैसे XML या स्प्रेडशीट।
हाँ, स्कैन बदल जाएगा, पर बिना टेक्स्ट लेयर के यह PDF/A के अंदर सिर्फ़ एक तस्वीर रहेगी और उसमें खोज नहीं चलेगी। अगर संग्रह में खोज ज़रूरी है तो पहले दस्तावेज़ पर OCR चलाएँ, फिर उसे बदलें।
PDF/A सभी फ़ॉन्ट और रंग प्रोफ़ाइल पूरी तरह अंदर रख लेता है, इसलिए आकार अक्सर बढ़ता है। संग्रह के लिए यह सामान्य बात है। अगर आकार बहुत मायने रखता है तो फ़ाइल को बदलने से पहले कम्प्रेस करें, बाद में नहीं, वरना दोबारा प्रोसेसिंग मानक तोड़ सकती है।
फ़ाइलें ब्राउज़र सत्र में प्रोसेस होती हैं और सर्वर से अपने आप हट जाती हैं। रजिस्ट्रेशन की ज़रूरत नहीं, और दस्तावेज़ों का इस्तेमाल AI को ट्रेन करने में नहीं होता।

इस क्लस्टर से और

संबंधित टूल

PDF कंप्रेस करें ऑनलाइन

PDF file का size कम करें ताकि उसे email, upload या store करना आसान हो. यह scans और images वाले documents के लिए खास उपयोगी है.

पीडीएफ की मरम्मत करें ऑनलाइन

पीडीएफ की मरम्मत करें PDF कार्य को एक ही ब्राउज़र प्रवाह में रखता है: स्रोत फ़ाइल अपलोड करें, विकल्प देखें, प्रक्रिया चलाएँ और परिणाम डाउनलोड करें.

पीडीएफ से ग्रेस्केल तक ऑनलाइन

रंगीन PDF पेजों को ग्रेस्केल में बदलें और साफ़ श्वेत-श्याम प्रिंट के लिए अलग फ़ाइल डाउनलोड करें, फिर पाठ और चार्ट का कंट्रास्ट जाँचें। एक उपयोगी उदाहरण है: रंगीन रिपोर्ट या स्कैन को श्वेत-श्याम प्रिंट के लिए तैयार करना.

PDF से खाली पेज हटाएँ

PDF से वे खाली पेज हटाएँ जो अक्सर दो-तरफ़ा scan और auto feeder के बाद आ जाते हैं.

← रूपांतरण श्रेणी के सभी टूल

आगे क्या करें

अगर पढ़ने के बाद आपको अगला व्यावहारिक कदम या सेवा के बारे में और मार्गदर्शन चाहिए, तो ये पेज खोलें.

सभी टूल्स

PDF tools catalog: PDF merge, compress, split, convert, rotate, protect और unlock करें, सब कुछ सीधे आपके browser में.

अक्सर पूछे जाने वाले प्रश्न

iHatePDF के बारे में frequently asked questions के जवाब: क्या registration जरूरी है, files कैसे process होती हैं, limits कहाँ देखें और documents upload करना safe है या नहीं।

संपर्क

Processing errors, tool चुनने, safety, business queries और नए features के सुझावों के लिए iHatePDF से संपर्क करें।