PDF रिडैक्ट करें

नाम, नंबर और चुने हुए हिस्से फ़ाइल से मिटाए जाते हैं, काले चौकोर के नीचे छिपाए नहीं, और एक रिपोर्ट इसे साबित करती है। सब आपके ब्राउज़र में।

PDF ARENA में खोलें

यह हटाता है, ढकता नहीं

रिडैक्ट हुआ पेज रास्टराइज़ हो जाता है। नीचे कोई टेक्स्ट ऑब्जेक्ट नहीं बचता।

यह आपके लिए ढूँढ़ लेता है

ईमेल, फ़ोन, पहचान संख्याएँ, IBAN और कार्ड, हर एक अपने ही गणित से जाँचा हुआ।

यह साबित करता है

नतीजा फिर से खोला और खोजा जाता है। दोनों हैश के साथ रिपोर्ट मिलती है।

रिडैक्शन जो हटाता है, ढकता नहीं

किसी नाम पर खींचा गया काला चौकोर रिडैक्शन नहीं है। वह एक चित्र है। उस फ़ाइल को दूसरे व्यूअर में खोलिए, क्षेत्र चुनिए, कॉपी, पेस्ट: नाम सीधा बाहर आ जाता है, क्योंकि नीचे पड़ा ऑब्जेक्ट कभी छुआ ही नहीं गया। न्यूज़रूम और वकीलों के दफ़्तर ठीक इसी तरह दस्तावेज़ लीक कर चुके हैं। यहाँ क्रम उलटा है। रिडैक्शन लागू करते ही उसे उठाने वाला पेज रास्टराइज़ हो जाता है — अपनी ही तस्वीर, और आपके क्षेत्र ठोस रंग से भरे हुए। काले के नीचे कुछ नहीं बचता। उस पन्ने पर एक भी ग्लिफ़ नहीं बचता। जिन पेजों को आपने चिह्नित नहीं किया, वे जैसे थे वैसे ही कॉपी होते हैं, इसलिए पचास पेज के अनुबंध में दो पंक्तियाँ सेंसर होने पर बाकी हर जगह वेक्टर, लिंक और चुनने-योग्य शब्द बने रहते हैं। सब कुछ आपके ब्राउज़र के भीतर होता है। कुछ भी अपलोड नहीं होता।

PDF कैसे रिडैक्ट करें

1

अपनी PDF खोलें

फ़ाइल यहाँ छोड़ दें। वह आपकी मशीन पर ही रहती है, और यह पेज एक बार लोड हो जाने के बाद टूल नेटवर्क बंद रहने पर भी चलता रहता है।

2

जो मिला उसे देखें

ईमेल, फ़ोन, पहचान कोड, IBAN और कार्ड, हर एक भरोसे के स्तर और अपनी वजह के साथ आता है। चुनाव आपका।

3

बाकी जो चाहिए वह जोड़ें

पूरे दस्तावेज़ में कोई शब्द या रेगुलर एक्सप्रेशन ढूँढ़ें, हस्ताक्षर पर बॉक्स खींचें, या पूरा पन्ना चिह्नित करें।

4

लागू करें और रिपोर्ट पढ़ें

नतीजा फिर से खोला जाता है, उसका टेक्स्ट बाहर खींचा जाता है, हर छिपाए गए मान को खोजा जाता है। आप जाँचें देखते हैं और दोनों हैश वाली रिपोर्ट डाउनलोड करते हैं।

क्या हटता है, और उसकी जाँच कैसे होती है

पहचान टेक्स्ट को वैसे ही पढ़ती है जैसे फ़ाइल उसे रखती है, किसी चपटे डंप से कभी नहीं। टुकड़ों को फिर से पढ़ने की पंक्तियों में जोड़ा जाता है, जिससे तीन टुकड़ों में बँटा फ़ोन नंबर भी सामने आ जाता है और तालिका का एक कॉलम अपने पड़ोसी से चिपकना बंद कर देता है। इसके बाद ही गणित तय करता है: DNI का नियंत्रण अक्षर, IBAN पर मॉड्यूलो 97, कार्ड पर Luhn। जो गणित में फ़ेल हो जाता है वह सिर्फ़ पैटर्न बनकर आता है, कम भरोसा, लेबल लगा हुआ। आपकी पीठ पीछे कुछ लागू नहीं होता। लागू करना तीन चरणों में चलता है। क्रम मायने रखता है। हर चिह्नित पन्ना रास्टराइज़ होता है और उसके बॉक्स भरे जाते हैं; फिर हर बॉक्स के भीतर नौ बिंदु वापस पढ़े जाते हैं ताकि पक्का हो कि वे पिक्सेल काले हुए, क्योंकि ब्राउज़र की आकार-सीमा से बड़ा कैनवास ड्रॉइंग के आदेश स्वीकार करता है और चुपचाप कुछ नहीं बनाता, और यही चुप्पी सेंसरशिप को दिखावटी बना देती है। लिखना तभी शुरू होता है जब सारे पन्ने पास हो जाएँ। इसके बाद मेटाडेटा, एनोटेशन, अटैचमेंट, एम्बेडेड JavaScript और लॉन्च क्रियाएँ जाती हैं, आपके स्विच के हिसाब से। आख़िरी चरण दावे को तथ्य बनाता है। तैयार PDF एक अलग कोड-रास्ते से फिर खोली जाती है, उसका टेक्स्ट निकाला जाता है, और हर छिपाए गए मान को विभाजक और अक्षरों का केस हटाकर दोबारा खोजा जाता है। रास्टराइज़ हुए पन्नों की जाँच होती है कि वे शून्य अक्षर लौटाएँ। मेटाडेटा की, कि वह खाली हो। कुछ भी विफल हुआ तो काम विफल घोषित होता है और कोई डाउनलोड नहीं आता। रिपोर्ट में इनपुट और आउटपुट का SHA-256 रहता है, हर जाँच अपने फ़ैसले के साथ, और हटाया गया हर मान एक हैश-छाप और उसके आख़िरी दो अक्षरों के रूप में: पहचानने के लिए काफ़ी, फिर से बनाने के लिए बेकार।

यही क्यों

सब कुछ आपके ब्राउज़र के भीतर चलता है। दस्तावेज़ किसी के पास नहीं जाता।

DNI, NIE, IBAN और कार्ड नंबर अपने ही गणित से जाँचे जाते हैं, शक्ल देखकर अंदाज़ा नहीं लगाया जाता।

हर काम सत्यापन के चरण पर ख़त्म होता है, और कोई जाँच विफल हो तो डाउनलोड नहीं मिलता।

PDF रिडैक्ट करने पर सवाल

छोटे जवाब, सीमाओं के साथ

क्या रिडैक्ट किया टेक्स्ट वापस निकाला जा सकता है?
उन पन्नों से नहीं जो उसे उठाते हैं। वे रास्टराइज़ हो जाते हैं, ग्लिफ़ ख़त्म और काले के नीचे कुछ नहीं। यह माना नहीं जाता, जाँचा जाता है: हर काम तैयार PDF को फिर खोलता है, उसका टेक्स्ट निकालता है और हटाए गए हर मान को खोजता है। एक भी सामने आया तो कोई फ़ाइल आपके पास नहीं पहुँचती।
क्या पूरा दस्तावेज़ तस्वीर बन जाता है?
सिर्फ़ वे पन्ने जो आपने चिह्नित किए। बाकी जैसे थे वैसे कॉपी होते हैं, वेक्टर, लिंक और चुनने-योग्य शब्द बरकरार।
मेटाडेटा और अटैचमेंट का क्या होता है?
डिफ़ॉल्ट रूप से शीर्षक, लेखक, विषय, कीवर्ड और XMP पैकेट खाली कर दिए जाते हैं, और अटैचमेंट, एम्बेडेड स्क्रिप्ट, लॉन्च क्रियाएँ तथा फ़ॉर्म परिभाषाएँ हट जाती हैं। हर एक एक स्विच है, आप उसे वापस चालू कर सकते हैं।
क्या यह स्कैन की गई PDF पर काम करता है?
बॉक्स काम करते हैं: आप खींचते हैं, वे पिक्सेल हमेशा के लिए ग़ायब। अपने-आप बनने वाले सुझावों को टेक्स्ट लेयर चाहिए, इसलिए सिर्फ़ फ़ोटो वाली फ़ाइल में कोई सुझाव नहीं आता। पहले OCR चलाएँ।
क्या कुछ सर्वर पर भेजा जाता है?
कुछ नहीं। पहचान, हटाव और सत्यापन, सब आपके ब्राउज़र में pdf.js और pdf-lib के ज़रिए चलता है। रिपोर्ट भी आपकी मशीन पर बनती है, और जो आप डाउनलोड करते हैं वह कभी बाहर नहीं गया।

अंतिम अपडेट

अपने PDF के साथ और भी बहुत कुछ करें

उन सभी पेशेवर टूल खोजें जो हमने आपके लिए तैयार किए हैं। सब कुछ एक ही जगह पर।