जो PDF नहीं खुलती, वह पूरी तरह गई हुई लगती है, पर आमतौर पर होती नहीं। अधिकांश मामलों में पन्नों की सामग्री फ़ाइल के भीतर ही, सही-सलामत और पढ़ने योग्य पड़ी रहती है — टूटता वह छोटा-सा आंतरिक हिसाब है जो रीडर को बताता है कि हर पन्ना कहाँ से शुरू होता है। फ़ाइल ठीक करने का अर्थ है उस हिसाब को दोबारा खड़ा करना, दस्तावेज़ को नए सिरे से बनाना नहीं।
यह गाइड बताती है कि असल में क्या टूटता है, बचाई जा सकने वाली फ़ाइल को सचमुच नष्ट हुई फ़ाइल से कैसे पहचानें, और बिना कुछ इंस्टॉल किए ब्राउज़र में PDF कैसे ठीक करें।
खराब PDF में असल में क्या टूटता है
PDF सादे पाठ की तरह लगातार बहती धारा नहीं है। यह क्रमांकित ऑब्जेक्ट का संग्रह है — फ़ॉन्ट, छवियाँ, पन्नों के विवरण, मेटाडेटा — और उसके बाद फ़ाइल के बिलकुल अंत में एक खोज-तालिका होती है जिसे क्रॉस-रेफ़रेंस तालिका या xref कहते हैं। यह तालिका हर ऑब्जेक्ट की सटीक बाइट-स्थिति दर्ज रखती है। जब कोई रीडर PDF खोलता है, वह अंत में जाता है, xref पढ़ता है और उसी से पन्ना एक ढूँढ़ता है।
यह बनावट तेज़ तो है, पर इसमें एक ख़ास कमज़ोरी है: अनुक्रमणिका अंत में रहती है और पीछे की ओर इशारा करती है। अगर कोई भी चीज़ ऑब्जेक्टों की स्थिति खिसका दे, या फ़ाइल की पूँछ पहुँचे ही नहीं, तो xref की सारी स्थितियाँ एक साथ ग़लत हो जाती हैं। रीडर पन्ना एक को बाइट 48,213 पर खोजता है, वहाँ कुछ ऐसा पाता है जो पन्ना नहीं है, और हार मान लेता है। जबकि पन्ने का अपना कुछ भी क्षतिग्रस्त नहीं हुआ होता।
- टूटी क्रॉस-रेफ़रेंस तालिका। अनुक्रमणिका मौजूद है पर उसकी स्थितियाँ अब वास्तविकता से मेल नहीं खातीं। PDF खराब होने का यह कहीं ज़्यादा आम रूप है और लगभग हमेशा ठीक हो जाता है।
- कटी हुई फ़ाइल। कोई अपलोड, डाउनलोड या कॉपी समय से पहले रुक गया, इसलिए फ़ाइल का आख़िरी हिस्सा — xref सहित — कभी पहुँचा ही नहीं। जहाँ तक फ़ाइल चलती है, वहाँ तक बचाई जा सकती है।
- क्षतिग्रस्त ऑब्जेक्ट धाराएँ। अलग-अलग ऑब्जेक्ट बदल गए हैं, आमतौर पर किसी ऐसे प्रोग्राम के कारण जिसने फ़ाइल में ग़लत लिखा। पन्ना-दर-पन्ना ठीक होती है; क्षतिग्रस्त पन्ने अपना स्वरूपण खो सकते हैं।
- ख़राब अंतर्निहित फ़ॉन्ट। पाठ मौजूद है पर जिस फ़ॉन्ट को वह संदर्भित करता है वह पढ़ा नहीं जा सकता, इसलिए पन्ने खाली या डिब्बों जैसे दिखते हैं। आमतौर पर मानक फ़ॉन्ट रखकर ठीक हो जाता है।
- अमान्य शीर्षिका। फ़ाइल
%PDF-से शुरू नहीं होती। इसका अर्थ अक्सर यह होता है कि वह वास्तव में PDF है ही नहीं, या उसके आगे कुछ जोड़ दिया गया है।
आम त्रुटि संदेश और उनका मतलब
आपका रीडर जो संदेश दिखाता है, वह इस बात का ठीक-ठाक संकेत है कि गड़बड़ कहाँ हुई। सबसे अधिक सामने आने वाले ये हैं:
| त्रुटि संदेश | इसका आमतौर पर क्या अर्थ है | बचाया जा सकता है? |
|---|---|---|
| «इस दस्तावेज़ को खोलने में त्रुटि हुई। फ़ाइल क्षतिग्रस्त है और उसे ठीक नहीं किया जा सका।» | Adobe का अपना मरम्मत प्रयास टूटी xref पर विफल रहा | आमतौर पर हाँ, किसी दूसरे उपकरण से |
| «PDF दस्तावेज़ लोड नहीं हो सका।» | Chrome शीर्षिका या xref को समझ नहीं पाया | आमतौर पर हाँ |
| «फ़ाइल या तो समर्थित प्रकार की नहीं है या क्षतिग्रस्त है।» | अमान्य या अनुपस्थित %PDF- शीर्षिका | कभी-कभी — जाँचें कि यह सचमुच PDF है |
| «dict ऑब्जेक्ट अपेक्षित था।» / «अमान्य ऑब्जेक्ट संख्या।» | क्षतिग्रस्त ऑब्जेक्ट धारा | आंशिक रूप से — बिना क्षति वाले पन्ने बच जाते हैं |
| खुलती है, पर सारे पन्ने खाली हैं | ख़राब या अनुपस्थित अंतर्निहित फ़ॉन्ट | आमतौर पर हाँ |
| खुलती है, पर बीच में ही रुक जाती है | कटी हुई फ़ाइल | केवल कटाव के बिंदु तक |
| «यह दस्तावेज़ संरक्षित है।» | यह ख़राबी है ही नहीं: फ़ाइल एन्क्रिप्टेड है | यह मरम्मत की समस्या नहीं |
वह आख़िरी पंक्ति दिखने से कहीं अधिक मायने रखती है। लोग मरम्मत उपकरण तक जो फ़ाइलें लाते हैं, उनका एक अच्छा-ख़ासा हिस्सा क्षतिग्रस्त होता ही नहीं — वे पासवर्ड से सुरक्षित होती हैं, और रीडर का संदेश बस अस्पष्ट होता है। अगर आपको पासवर्ड पता है, तो मरम्मत की कोशिश करने के बजाय PDF सुरक्षित करें से फ़ाइल का एन्क्रिप्शन सँभालें।
क्या वापस मिल सकता है और क्या नहीं
यहाँ उम्मीदों को ईमानदारी से तय करना आशावाद से अधिक क़ीमती है, क्योंकि यही बताता है कि किसी फ़ाइल पर समय लगाना कब बंद करके मूल प्रति ढूँढ़ने निकल जाना चाहिए।
- लगभग हमेशा बचाई जा सकती हैं: टूटी xref तालिकाएँ, ऐसी फ़ाइलें जिन्हें रीडर खोलने से मना करता है पर जो बाक़ी सब तरह से पूरी हैं, ऐसे प्रोग्राम की सहेजी PDF जो लिखते-लिखते बंद हो गया, और फ़ॉन्ट की गड़बड़ी से खाली दिखने वाली फ़ाइलें।
- आंशिक रूप से बचाई जा सकती हैं: कटी हुई फ़ाइलें। जिस बाइट पर फ़ाइल रुकती है वहाँ तक सब कुछ मिलता है, उसके बाद कुछ नहीं। 80% तक पहुँचा डाउनलोड आमतौर पर लगभग 80% पन्ने सही-सलामत देता है।
- कम ही बचाई जा सकती हैं: ऐसी फ़ाइलें जिनकी ऑब्जेक्ट धाराओं पर ही असंबद्ध डेटा लिख दिया गया हो, जैसे किसी बिगड़ती डिस्क या मरणासन्न मेमोरी कार्ड की वजह से। अनुक्रमणिका दोबारा बन तो जाएगी, पर वह ऐसी सामग्री की ओर इशारा करेगी जो सचमुच जा चुकी है।
- यह मरम्मत की समस्या है ही नहीं: एन्क्रिप्टेड फ़ाइलें, वे फ़ाइलें जो कभी PDF थीं ही नहीं (जैसे किसी Word दस्तावेज़ पर
.pdfएक्सटेंशन), और 0-बाइट फ़ाइलें। 0-बाइट फ़ाइल के भीतर बचाने को कुछ होता ही नहीं।
मरम्मत से पहले आज़माने लायक़ तीन चीज़ें
इनमें से हर एक में एक मिनट से भी कम लगता है और हर एक ऐसी वास्तविक श्रेणी की समस्या सुलझाती है जो ख़राबी है ही नहीं:
- इसे किसी दूसरे रीडर में खोलिए। रीडर इस मामले में बहुत भिन्न होते हैं कि वे बेढंगी फ़ाइलों के प्रति कितने उदार हैं। जिस PDF को Adobe Acrobat सिरे से नकार देता है, वह अक्सर Chrome या Firefox में खुल जाती है, जो छोटी-मोटी संरचनात्मक गड़बड़ियाँ चुपचाप सुधार लेते हैं। ब्राउज़र में खुल जाए तो उसे फिर से PDF में प्रिंट कर लीजिए और आपके पास साफ़ प्रति आ गई।
- इसे दोबारा डाउनलोड कीजिए। अगर फ़ाइल नेटवर्क से आई थी, तो सबसे सरल व्याख्या यही है कि स्थानांतरण विफल हुआ। दोबारा डाउनलोड कीजिए और फ़ाइल को दोषी मानने से पहले उसका आकार स्रोत से मिलाइए।
- जाँचिए कि यह PDF है भी या नहीं। इसे किसी भी सादे टेक्स्ट एडिटर में खोलकर पहली पंक्ति देखिए। असली PDF
%PDF-1.4या उसी जैसे से शुरू होती है। अगरPKदिखे तो वह ग़लत एक्सटेंशन वाली ZIP या Office फ़ाइल है; अगर<!DOCTYPE html>दिखे तो आपने दस्तावेज़ के बजाय कोई त्रुटि पृष्ठ डाउनलोड कर लिया है।
तीन चरणों में PDF ठीक करें
अगर फ़ाइल सचमुच क्षतिग्रस्त है, तो PdfDocShift से उसकी मरम्मत तीन चरणों में हो जाती है। न कोई इंस्टॉलेशन, न साइन-अप, और अपलोड की गई हर फ़ाइल दो घंटे बाद हमारे सर्वर से स्थायी रूप से मिटा दी जाती है।
रिपेयर PDF टूल खोलें
pdfdocshift.com/repair-pdf पर जाइए और क्षतिग्रस्त फ़ाइल को अपलोड क्षेत्र में खींचिए, या ब्राउज़ करने के लिए क्लिक कीजिए। फ़ाइल को ठीक उसी रूप में अपलोड कीजिए जैसी वह है: पहले उसका नाम मत बदलिए, दोबारा मत सहेजिए, और न ही खोलकर फिर से निर्यात कीजिए — इनमें से हर काम बचाई जा सकने वाली संरचना पर लिख सकता है।
मरम्मत की प्रक्रिया चलने दीजिए
उपकरण मौजूदा अनुक्रमणिका पर भरोसा करने के बजाय पूरी फ़ाइल में वैध PDF ऑब्जेक्ट खोजता है, जो मिलता है उससे पन्नों का वृक्ष दोबारा खड़ा करता है, क्रॉस-रेफ़रेंस तालिका नए सिरे से बनाता है, और जो भी अंतर्निहित फ़ॉन्ट पढ़ा न जा सके उसकी जगह मानक फ़ॉन्ट रख देता है। अधिकांश फ़ाइलें कुछ ही सेकंड में पूरी हो जाती हैं; बहुत बड़ी या बुरी तरह क्षतिग्रस्त फ़ाइलों में अधिक समय लगता है।
डाउनलोड कीजिए और जाँचिए
मरम्मत की गई फ़ाइल डाउनलोड कीजिए और उसे ढंग से जाँचिए — सिर्फ़ पहला पन्ना नहीं। पुष्टि कीजिए कि पन्नों की संख्या आपकी अपेक्षा से मेल खाती है, फिर बीच का एक पन्ना और आख़िरी पन्ना नमूने के तौर पर देखिए। अगर पन्ने कम हैं तो फ़ाइल कटी हुई थी, और जो आपके पास है वही सब कुछ है जो बचा।
क्षतिग्रस्त PDF अभी ठीक करें
मुफ़्त, बिना साइन-अप, फ़ाइलें 2 घंटे बाद हटा दी जाती हैं। अधिकांश फ़ाइलें 10 सेकंड से कम में ठीक हो जाती हैं।
रिपेयर PDF खोलें →स्कैन की गई और छवि-भारी PDF ठीक करना
स्कैन किए दस्तावेज़ पाठ वाले दस्तावेज़ों से अलग तरह से खराब होते हैं, और उन्हें अलग मामला मानना उचित है। स्कैन की गई PDF बड़ी छवियों का पात्र होती है, इसलिए फ़ाइल का कहीं बड़ा हिस्सा छवि-डेटा होता है: इसका अर्थ है कि कटाव आपको टूटी अनुक्रमणिका के बजाय पूरे पन्ने गँवाता है, और अधूरी फ़ाइल अक्सर किसी छवि के बीचोंबीच ख़त्म होकर आख़िरी पन्ना आधा बना छोड़ देती है।
इससे दो बातें निकलती हैं। पहली: स्कैन की गई PDF की मरम्मत उसके साथ कुछ और करने से पहले कीजिए; क्षतिग्रस्त स्कैन पर संपीड़न या रूपांतरण चलाने से नुक़सान प्रायः स्थायी रूप से पक्का हो जाता है। दूसरी: अगर मरम्मत की गई फ़ाइल खुलती तो है पर पाठ चुना नहीं जा सकता, तो पाठ परत नहीं बची — मरम्मत की गई फ़ाइल को OCR PDF से गुज़ारकर आप उसे दोबारा बना सकते हैं, जो छवियों को पढ़कर उनके नीचे नई, खोजी जा सकने वाली पाठ परत लिख देता है।
अगर बचाया गया स्कैन बाद में भारी लगे — मरम्मत कभी-कभी मूल से बड़ी फ़ाइल बनाती है, क्योंकि वह टूटी संपीड़न संरचनाओं का दोबारा उपयोग नहीं कर सकती — तो PDF कंप्रेस करें उसे पन्नों को छुए बिना फिर से छोटा कर देगा।
PDF कैसे खराब होती हैं और इसे कैसे रोकें
वास्तविक दुनिया की लगभग सारी PDF ख़राबी कुछ ही कारणों तक सिमटती है, और उनमें से ज़्यादातर टाली जा सकती हैं:
- बीच में टूटे स्थानांतरण। बीच में कटा डाउनलोड, कॉपी करते समय टूटा नेटवर्क शेयर, या लिखाई पूरी होने से पहले निकाली गई USB ड्राइव। हटाने योग्य मीडिया हमेशा ठीक तरह से बाहर निकालिए और बड़े स्थानांतरणों के बाद फ़ाइल का आकार जाँचिए।
- क्लाउड में फ़ाइल को सिंक होते समय संपादित करना। जिस PDF को Dropbox, OneDrive या Google Drive उसी समय अपलोड कर रहा हो, उस पर सहेज देना आधी पुरानी-आधी नई फ़ाइल बनाने का पक्का तरीक़ा है। फ़ाइल खोलने से पहले सिंक पूरा होने दीजिए।
- सहेजते समय बंद हो जाने वाले ऐप्लिकेशन। जिस प्रोग्राम ने अनपेक्षित रूप से बंद होते हुए PDF लिखी, उसमें आमतौर पर सामग्री तो होती है पर वैध अनुक्रमणिका नहीं — यही मरम्मत योग्य क्लासिक मामला है।
- पुराने सर्वरों से PDF को इनलाइन अनुलग्नक के रूप में भेजना। कुछ पुराने मेल सिस्टम आज भी द्विआधारी अनुलग्नकों पर टेक्स्ट-मोड एन्कोडिंग लगाते हैं, जिससे वे रास्ते में ख़राब हो जाते हैं। जिस सिस्टम पर भरोसा न हो, उसके लिए भेजने से पहले फ़ाइल को ज़िप कर लीजिए।
- बिगड़ता संग्रहण। ख़राब सेक्टर और मरणासन्न मेमोरी कार्ड फ़ाइलों को चुपचाप ख़राब करते हैं। अगर किसी ड्राइव की एक से ज़्यादा फ़ाइलें ख़राब हुई हैं, तो समस्या ड्राइव में है — कुछ और करने से पहले उससे सब कुछ कॉपी कर लीजिए।
अक्सर पूछे जाने वाले प्रश्न
नहीं, पर ज़्यादातर हो जाती हैं। टूटी क्रॉस-रेफ़रेंस तालिकाएँ — PDF के न खुलने का कहीं सबसे आम कारण — लगभग हमेशा ठीक हो जाती हैं, क्योंकि पन्नों की सामग्री अछूती रहती है और केवल अनुक्रमणिका दोबारा बनानी होती है। कटी हुई फ़ाइलें जहाँ तक चलती हैं वहाँ तक बच जाती हैं। जिन फ़ाइलों की असल सामग्री डिस्क की ख़राबी से मिट चुकी हो, वे आमतौर पर नहीं बचतीं, और 0-बाइट फ़ाइल को कोई उपकरण नहीं बचा सकता।
ऐसा नहीं होना चाहिए। मरम्मत फ़ाइल की संरचनात्मक अनुक्रमणिका और पन्नों का वृक्ष दोबारा बनाती है; पन्नों की सामग्री ज्यों की त्यों कॉपी होती है। एकमात्र अपवाद अंतर्निहित फ़ॉन्ट हैं: अगर कोई फ़ॉन्ट पढ़ा न जा सके तो मरम्मत उसकी जगह मानक फ़ॉन्ट रख देती है, जिससे पन्ने पर पाठ का अंतराल या सजावट थोड़ी बदल सकती है। शब्द स्वयं अप्रभावित रहते हैं।
ब्राउज़र बेढंगी PDF के प्रति Acrobat से कहीं अधिक उदार होते हैं। Chrome और Firefox टूटी क्रॉस-रेफ़रेंस तालिका को चुपचाप दरकिनार करते हुए फ़ाइल में पन्ने खोज लेते हैं, जबकि Acrobat संरचना की जाँच करता है और जो फ़ाइलें उसमें खरी नहीं उतरतीं उन्हें नकार देता है। यह उपयोगी संकेत है: अगर फ़ाइल ब्राउज़र में खुल जाती है तो सामग्री सही-सलामत है और मरम्मत लगभग निश्चित रूप से सफल होगी।
आमतौर पर यह पन्नों की क्षति नहीं बल्कि फ़ॉन्ट की समस्या होती है। पन्ने की सामग्री मौजूद है पर वह ऐसे अंतर्निहित फ़ॉन्ट को संदर्भित करती है जिसे रीडर पढ़ नहीं सकता, इसलिए कुछ भी नहीं बनता। मानक फ़ॉन्ट रखने वाली मरम्मत प्रक्रिया आमतौर पर दिखने वाला पाठ लौटा देती है। इसके बाद भी पन्ने खाली रहें तो हो सकता है दस्तावेज़ में सचमुच खाली पन्ने हों — कितने पन्नों में सामग्री है यह जाँचने के लिए खाली पन्ने हटाएँ आज़माइए।
तब सुरक्षित है जब उपकरण अपलोड को भेजे जाते समय एन्क्रिप्ट करता हो और फ़ाइलें जल्दी मिटा देता हो। PdfDocShift हर अपलोड के लिए 256-बिट SSL इस्तेमाल करता है और दो घंटे बाद हर फ़ाइल अपने सर्वर से स्थायी रूप से मिटा देता है। अत्यंत संवेदनशील सामग्री के लिए पहले फ़ाइल ठीक कीजिए, फिर साझा करने से पहले PDF सुरक्षित करें उपकरण से उसमें पासवर्ड जोड़िए, जो 256-बिट AES एन्क्रिप्शन लगाता है।
नहीं। मरम्मत और डिक्रिप्शन बिलकुल अलग-अलग काम हैं। मरम्मत उपकरण क्षतिग्रस्त फ़ाइल की संरचना दोबारा बनाता है; वह एन्क्रिप्शन न हटाता है न वापस लाता है। अगर कोई PDF त्रुटि संदेश के बजाय पासवर्ड माँगते हुए खुलती है, तो फ़ाइल क्षतिग्रस्त नहीं है — वह संरक्षित है, और आपको पासवर्ड चाहिए होगा।
अपनी फ़ाइल वापस पाने को तैयार हैं?
मुफ़्त, बिना साइन-अप, फ़ाइलें 2 घंटे बाद हटा दी जाती हैं। हर डिवाइस पर चलता है, बिना किसी इंस्टॉलेशन के।
रिपेयर PDF खोलें →