तुलना दो तरह की होती है
पाठ की तुलना दोनों फ़ाइलों से शब्द निकालकर आमने-सामने रखती है और बताती है क्या जोड़ा, हटाया और बदला गया। दृश्य तुलना पन्नों को तस्वीर की तरह एक पर एक रखकर दिखाती है कि पिक्सल कहाँ अलग हैं। अनुबंध, कोटेशन और रिपोर्ट के लिए पहली चाहिए। नक़्शे, लोगो और लेआउट के प्रूफ़ के लिए दूसरी।
पाठ की तुलना क्या पकड़ती है
- जोड़ी या हटाई गई धाराएँ।
- बदले हुए आँकड़े: तारीख़, दाम, नोटिस की अवधि।
- बस एक शब्द का पलटना, जैसे "सकता है" से "करना होगा", और यही वह बदलाव है जो जल्दी पढ़ने में कभी नहीं मिलता।
यह बदला हुआ फ़ॉन्ट, हिली हुई तस्वीर, या अगले पन्ने पर खिसका दस्तख़त का हिस्सा नहीं देखेगी, क्योंकि इनमें से कोई भी पाठ नहीं बदलता।
यह क्या नहीं पकड़ती
अगर PDF स्कैन है तो तुलना करने के लिए पाठ ही नहीं है: पन्ना शब्दों की तस्वीर है। पहले पाठ पहचान चलाएँ, फिर पहचाने गए पाठ की तुलना करें। पहचान पूरी तरह सही नहीं होती, इसलिए एक-एक अक्षर के कुछ अजीब फ़र्क़ों को असली बदलाव के बजाय ग़लत पढ़ाई मानें।
नतीजा कैसे पढ़ें
तुलना पंक्ति-दर-पंक्ति चलती है, इसलिए एक जोड़ा हुआ वाक्य आगे की सारी पंक्तियाँ खिसका सकता है और बाक़ी पूरा पन्ना जगमगा सकता है। देखें कि फ़र्क़ कहाँ से शुरू होता है, कितना उजागर हुआ यह नहीं। हाशिए बदलने पर दोबारा सजे पैराग्राफ़ भी यही करते हैं: शब्द वही हैं पर हर पंक्ति का टूटना खिसक गया है।
तुलना से पहले
- पन्नों की संख्या देखें। अलग हो तो ढाँचे में कुछ बदला है, और वह पहले ढूँढना बेहतर है।
- शब्दों की गिनती मिलाएँ। बड़ा फ़र्क़ बताता है कि सामग्री खिसकी; गिनती वही पर फ़र्क़ दिखे तो शब्द बदले गए।
- वही हिस्सा लें। पूरे दस्तावेज़ की किसी अंश से तुलना करने पर जानकारी नहीं, शोर मिलता है।
गोपनीयता
अनुबंध, वेतन की फ़ाइलें और मेडिकल रिकॉर्ड ठीक वही दस्तावेज़ हैं जिन्हें लोग फ़र्क़ देखने के लिए किसी अनजान के सर्वर पर चढ़ा देते हैं। ब्राउज़र में चलने वाली तुलना फ़ाइल कहीं नहीं भेजती, और गोपनीय चीज़ों के लिए यही एक तरीका काम का है।
उपकरण
PDF फ़ाइलों की तुलना दो PDF का पाठ आमने-सामने रखती है और आपके ब्राउज़र में निशान लगाती है कि क्या बदला। पाठ तुलना चिपकाए हुए पाठ के लिए वही करती है, PDF शब्द गिनती जल्दी जाँच के लिए गिनती देती है, और तस्वीर से पाठ स्कैन किए पन्ने के शब्द पहचान लेता है ताकि तुलना करने लायक कुछ हो।