समानता और सादृश्यता
दोनों संरेखण से स्तंभ-दर-स्तंभ पढ़ी जाती हैं। प्रतिशत समानता उन स्तंभों का हिस्सा है जहाँ दोनों अनुक्रमों में एक ही अवशेष है। प्रतिशत सादृश्यता उन स्तंभों को भी गिनती है जहाँ अवशेष अलग हैं पर रासायनिक रूप से मिलते-जुलते हैं, जैसे ल्यूसीन बनाम आइसोल्यूसीन या एस्पार्टेट बनाम ग्लूटामेट। सादृश्यता सिर्फ़ प्रोटीन के लिए सार्थक है; DNA के लिए समानता ही इस्तेमाल करें।
हर मायने रखता है
90 समान स्तंभों वाले दो अनुक्रमों को 100 स्तंभों के संरेखण पर 90% समान, 120 अवशेषों वाले लंबे अनुक्रम पर 75%, या बिना गैप वाले 95 स्तंभों पर 95% बताया जा सकता है। टूल अलग-अलग हैं:
- BLAST गैप समेत संरेखण की लंबाई से भाग देता है।
- EMBOSS Needle भी वही करता है पर गैप अलग से रिपोर्ट करता है।
- कुछ टूल छोटे अनुक्रम से भाग देते हैं, जो लंबे प्रोटीन के हिस्से से मेल खाते छोटे टुकड़े का अंक बढ़ा-चढ़ा देता है।
कोई अंक उद्धृत करते समय बताएँ कि उसे किससे भाग दिया गया और संरेखण ग्लोबल था या लोकल।
कौन से अवशेष सदृश हैं
सादृश्यता समूह आमतौर पर BLOSUM62 मैट्रिक्स के धनात्मक स्कोर पर चलते हैं। आम समूह: I, L, V और M; F, Y और W; K, R और H; D और E; N और Q; S और T; A और G। ज़्यादातर टूल अपना नियम दिखाते हैं; यहाँ का समानता और सादृश्यता टूल समान और सदृश स्तंभों को अलग-अलग चिह्नित करता है।
अंकों का मतलब
पूरी लंबाई में 30% से ज़्यादा समान दो प्रोटीन लगभग हमेशा समजात होते हैं और एक ही फ़ोल्ड साझा करते हैं। 20 से 30% के बीच धुँधला क्षेत्र है, जहाँ संरेखण असली भी हो सकता है और संयोग भी, और डेटाबेस खोज का सांख्यिकीय E-मान बेहतर मार्गदर्शक है। DNA मूक स्थितियों पर तेज़ी से अलग होता है, इसलिए लगभग समान प्रोटीन कोड करने वाले दो जीन DNA स्तर पर सिर्फ़ 70% समान हो सकते हैं।
गणना करें
- अनुक्रमों को दो प्रोटीन संरेखित करें या दो DNA संरेखित करें से संरेखित करें, या पहले से मौजूद संरेखण चिपकाएँ।
- संरेखित अनुक्रम समानता और सादृश्यता में चिपकाएँ। यह समान और सदृश स्तंभ गिनता है और संरेखण की लंबाई के साथ दोनों प्रतिशत रिपोर्ट करता है।