PDF तुलना

दो PDF के बीच एक साथ तीन तुलनाएँ: शब्द दर शब्द, पिक्सेल दर पिक्सेल, और जुड़े, हटे या खिसके पन्ने। दोनों फ़ाइलें आपके ब्राउज़र में ही रहती हैं।

PDF ARENA में खोलें

एक साथ तीन तुलनाएँ

टेक्स्ट, पिक्सेल और पेज संरचना, तीनों अलग-अलग रिपोर्ट होते हैं, एक ही आँकड़े में घुले नहीं।

पहले पेज जोड़ों में मिलाए जाते हैं

बीच में एक शीट डालिए और पेज 5 अब पेज 5 नहीं रहता। कुछ भी तुलना करने से पहले संरेखण होता है।

सबूत, विशेषण नहीं

हर बदलाव दिखाता है कि पहले क्या लिखा था और अब क्या लिखा है। वर्गीकरण सिर्फ़ सूची को क्रम में लगाता है।

दो PDF की तुलना, बिना झूठ बोले

ज़्यादातर तुलना उपकरण पेज 1 को पेज 1 के सामने रखते हैं और आगे बढ़ जाते हैं। किसी अनुबंध के बीच एक शीट डाल दीजिए और उसके बाद का हर पेज खिसक जाता है, तो रिपोर्ट उन अंतरों से भर जाती है जो अंतर नहीं हैं। दस्तावेज़ चालीस बार नहीं बदला। एक बार बदला। इसलिए जोड़े पहले बनते हैं। हर पेज की सामान्यीकृत टेक्स्ट से एक छाप निकलती है, पेज समानता के आधार पर मिलाए जाते हैं, और मिलान अंतरालों के दंड के साथ चलता है। जोड़, हटाव और खिसकाई गई शीटें वही निकलती हैं जो वे हैं। उसके बाद ही कुछ तुलना में जाता है। इसके बाद तीन पास अलग-अलग चलते हैं। शब्द बताते हैं कि टेक्स्ट अब क्या कहता है। पिक्सेल बताते हैं कि कौन से हिस्से खिसके, तब भी जब अक्षर वही हैं। संरचना बताती है कि शीटों के साथ ख़ुद क्या हुआ।

दो PDF की तुलना कैसे करें

1

दोनों दस्तावेज़ लोड करें

बाईं ओर मूल, दाईं ओर संशोधित। दूसरा आते ही तुलना शुरू हो जाती है।

2

बदलावों की सूची पढ़ें

भार के हिसाब से क्रम में, तो आँकड़े, तारीख़ें और राशियाँ कॉमा से पहले आती हैं। हर पंक्ति पुराना टेक्स्ट और नया, दोनों दिखाती है।

3

पेजों को देखें

जोड़ा पहले से संरेखित करके आमने-सामने, या एक स्लाइडर के साथ ओवरले करके एक से दूसरे में फ़ेड करें।

4

सबूत साथ ले जाएँ

बदले हुए हिस्सों पर चौखटे लगे एक चिह्नित PDF, साथ में रिपोर्ट JSON के रूप में और बदलाव CSV के रूप में।

तीनों तुलनाएँ कैसे काम करती हैं

पेज की छाप शब्द-समुच्चयों और अक्षर-त्रिलेखों से बनती है, अंकों को सामान्यीकृत करके और दोहराए गए बैनर हटाकर। समानता दोनों पर Jaccard गुणांक है। जोड़े बनाने का काम ख़ुद अंतराल-दंड वाला संपादन-दूरी पास है, और क्रम पर दूसरी नज़र उन शीटों को पकड़ती है जो दोनों तरफ़ मौजूद हैं पर किसी और क्रम में: उन्हें स्थान बदला हुआ बताया जाता है। हटाव जमा जोड़ के रूप में नहीं। टेक्स्ट पास शब्द-स्तर का अंतर-मिलान है जिसका संपादन बजट सीमित है, तो पूरी तरह फिर से लिखा गया सौ पेज का दस्तावेज़ टैब को लटकाने के बजाय मोटी रिपोर्ट पर उतर आता है। हर रन को लेबल मिलता है: आँकड़ा, तारीख़, प्रतिशत, राशि, व्यक्तिवाचक नाम। लेबल सिर्फ़ क्रम लगाने के लिए भार तय करता है। पंक्ति हमेशा पहले और बाद का शब्दशः पाठ साथ रखती है, क्योंकि लेबल सबूत नहीं है। दृश्य पास दोनों शीटों को एक ही स्केल पर रेंडर करता है और उनकी तुलना आठ गुणा आठ पिक्सेल के खंडों में करता है, एक सहनशीलता के साथ जो एंटीएलियासिंग का शोर सोख लेती है। अलग निकले खंड आयतों में जुड़ जाते हैं, और वही आयत आप चिह्नित PDF में चौखटों के रूप में देखते हैं। यही वह पास है जो खिसका हुआ लोगो, चौड़ा किया गया हाशिया या बदली गई हस्ताक्षर छवि पकड़ता है। इनमें से कोई एक भी अक्षर को नहीं छूता। छननियाँ इसलिए हैं कि एक ही PDF के दो निष्कर्षण खाली जगह को अलग-अलग बाँटते हैं, और इसलिए कि एक शीट डालने से उसके बाद का हर फुटर फिर से क्रमांकित हो जाता है।

यही क्यों

तुलना से पहले शीटें जोड़ों में मिलाई जाती हैं, तो एक जोड़ एक ही बदलाव के रूप में पढ़ा जाता है।

दृश्य अंतर टेक्स्ट वाले अंतरों से अलग रिपोर्ट होते हैं, कभी मिलाए नहीं जाते।

पूरा काम आपके ब्राउज़र में चलता है। कोई भी दस्तावेज़ अपलोड नहीं होता।

PDF तुलना पर सवाल

छोटे जवाब, सीमाएँ शामिल

अगर दोनों फ़ाइलों के पेजों की संख्या अलग हो तो?
यह उपकरण उसी हालत के लिए बना है। शीटें सामग्री के आधार पर मिलाई जाती हैं, तो डाली गई शीट को डाली गई बताया जाता है और उसके बाद का सब कुछ अपने समकक्ष के साथ ही बैठता रहता है।
स्कैन किए दस्तावेज़ों पर काम करता है?
दृश्य पास करता है, और अक्सर वही काफ़ी दिखा देता है। शब्द पास को टेक्स्ट परत चाहिए, तो शुद्ध स्कैन पर उसे कुछ नहीं मिलता। पहले OCR चलाएँ।
इसमें कुछ भी किसी AI मॉडल से होता है?
नहीं। सब कुछ टेक्स्ट और पिक्सेल पर गणित है, स्थानीय रूप से चलता है। कुछ भी अनुमान से नहीं निकाला जाता और कोई मॉडल तय नहीं करता कि बदलाव क्या गिना जाए।
अंत में क्या निकलता है?
संशोधित का एक PDF जिसमें बदले हुए हिस्सों पर चौखटे हैं, पूरी रिपोर्ट JSON में शीटों के नक़्शे और हर बदलाव के साथ, और स्प्रेडशीट के लिए एक CSV।
कुछ बदलाव आँकड़ा या तारीख़ क्यों चिह्नित होते हैं?
सूची को क्रम में लगाने के लिए। बदली हुई राशि आम तौर पर बदले हुए कॉमा से ज़्यादा मायने रखती है, तो वह ऊपर तैरती है। शब्दशः पाठ दोनों हालत में दिखता है।

अंतिम अपडेट

अपने PDF के साथ और भी बहुत कुछ करें

उन सभी पेशेवर टूल खोजें जो हमने आपके लिए तैयार किए हैं। सब कुछ एक ही जगह पर।