Bioinformatics and Functional Genomics Student ID: 21485094
Lecturer: Dr. Obed Brew Beatriz Manso
8
Do you think local or global alignment is best for finding similar parts of distantly related
proteins? Why? Hint: Distantly related proteins typically share a core that relates to the
function of the protein
The prokaryotic protease matches only a single area in the middle of the human protease. In contrast,
this is not clear in the global alignment with end gaps, which "spreads" the short sequence over the
entire length. For distantly related sequences, it would be best to use local alignment because it would
actually provide an optimal analysis of the comparable part of the sequences.
Open the "Shuffle Protein" page
(http://www.bioinformatics.org/sms2/shuffle_protein.html) in a new window/tab, paste
in the tripeptidyl peptidase sequence and shuffle it.
Shuffle Protein results:
Version1:
>results for 1249 residue sequence "sp|P29144|TPP2_HUMAN Tripeptidyl-peptidase 2 OS=Homo sapiens OX=9606
GN=TPP2 PE=1 SV=4" starting
"MATAATEEPF"FCLKCEETKLGSQKVMGSTVNQKKKIVNSEKHGPYNVEKIIAVSLNFCNVILSGIARDGRDNHDVLARPLDHSYEKNENEQNPLYPDNKFHGSMNLAAN
AVVIHHSLALRIDQKCGSKPPTLLDAYDVYQVCKGEIGERPPVSLSELESKWPSITELKMPSGYISTGGWRLIGTEEDFEWIQLPTMTCSSTEWNNFRDLEGPKISELLKG
TELSDPWYLYFHRLLDLELLDWKLSEKGFTVIFYETYGKQLSHGKTETTYHAYGKKSLLSVSQLSDRDNRSRVDVIWIALALGAINAIVTTNSVKVAAVKALSWVVKATFG
CIYVTGPDSRKKAIRAYVGDGFRIYDVLTAQAMKNTGLTRMVLFNSAYKAGLSDNYVPNKLGDSAERHGRTDITAELYTEGLRNVSTAGETYLPDAAPGTKLLDAKNDPSG
PDQRAYSYKSLSLNKGYVSARSTPSDGVQANGRKHSLRIISAAAIVSSPPGYIKLPEEFPFYSNHCVQFITTERPNPETQVCWEITCRSTKTLGLMRQSAALLTIANLSFT
VLGQGLDGQCGTTGGLANELQSEDRKPPGILLRSCINTRKGPPEQNLEALWKTTLPVIIEHHGDESKSNFETPFYKTIQHLVEHQHHNKYIVYTTLSHEGSEAIYASRRPK
WNGAGANYELENFRYHEILGDFPQADGATGEDIEKLANVIEGYRIEESSTTQAGLVSKGIGVKAFKDLSITWMPVELPDHNARLDKKLYIASGVEGVITLDICEQGLKICV
LQQDPVPADKPFCYHSEFQPSATLIPFIDDRSEEDNIGGPDIMTVNMIAEQPVAIRQYDSSVHKTAAFFANSATAMPFAGMRVIAHRTPAGHYDLQENASSWVVSCVVWTE
EWDLRGRSSLLTGMLNTNVIVSFKSATFKHGAVSDHTDAITDCRPTVPDSKGACQKGYEEKMIEGLASIELKTHKANADVEDFPQNPPGLYVHKADLCVQNEGLAIDIKVL
HLPNFGRDNREILALPNSSVAKEPLNHHAVCKIISAISSNKDPFLEIKIEGATVVFKKTVSTEGTDKQLVGYFPLFTNPSGADGNNPMVLPLANENLIKDKGYIYDRPSDG
VTVCTAYGALGQKGACWQYIASWAMDKYSGSPDAYNKVYKLPEKVILLEIWPSSVCMRAPEKHDFEVCPEENLEGGMAAQLTKLPVNVLDQTKCYDLHNELHGVEYGFGRL
VIPIEQFSADNDKKAERVWSAQTKAPPLLVMDVCEWHAHL
Version 2:
>results for 1249 residue sequence "sp|P29144|TPP2_HUMAN Tripeptidyl-peptidase 2 OS=Homo sapiens OX=9606 GN=TPP2 PE=1
SV=4" starting "MATAATEEPF"
NHHIAIDKEPRWLVADTKEASNGVAVNVYIGKEIADLTEGAGLDVTAYCADNPELSGPGDSYEIDARPQKEKGSPMALGWAVPKWEDVDVVAPKICTIGAAIYELRINDAVQGFKELCP
PTTKIHTNPIWASDNSIWNLCDKKIGSMDISDFFVDQFFEDEYHYPMAEGLTLPDLMSGDWEQINKYMITKESSIMAPCNRAYLTWLKGTDCSVRQAMPGWDIPHSAVSMSNLCFNVSV
QVTEHSLVSIVKNKRAPAGQLQLKLSSKDTDGARPVGIYRNKAEEHSTLIGEAIVSLLGLQINHKIYSCKIAPTASDEWLPKGYERSREKGGKSYEDRTTINTKVGEISVWSDRADYDI
NFEVQITVVPEAPYPYGTLCATISNSRVVRGVALHDLLPYFEGHKQYITQVKKRDCPDMIGMLKRSTVLSEFSVSQTSIDGYSFDRSGERDMISAYAIEHNFQQGDQLEPYKGLKGNTI
VKVGGLGENQKLPCPLGNIAAQHDTYFVSYNVALLIAVQGPAPDCAPPNLLLADWVVTNIVSNEIPMKTTASLTCNLDFKHDPTGDSASPLGEGESYVVLLIAKDVEKGAYALKGDCAV
NDYSIFTLIYKLQYPYAERYSGTKAIVRSPCYKQPRLKDLATELGKFTANNDNLHHSTDEGPTVRLCPRSFELSKQPHCPSEMGWRSNPWSGLLEVIAKELGTTRTGKIPSYPALLLGD
LPQLLLVEAKLVGSRDLTFSKTFTVSGPVRDGDIEWHIQSEAYKCEKAKREAFAGIPSGRTEPKTFHLLPACSFSAAAGKDIITAKAWGGHLQSPKSTIVWDGYNSTTFPACNHAKEEL
VSPQEINDWISWIGKIRELHDDSLKLYAPMVKTPGTASGTVTNAAGDDNFGDMPTPNTKKLLEVRNMNIEKTLQTSGQCPLAEANGIRLASALLSYQVPLNLLVQVRTILGTSIVEAFG
WHCPLLHEILKKRNLDLTDVINAAITVFQSDDIKSDGAYINTQETPAAKSQATHALSWRADGLAEQHNHNSSKKNTKGSCVVGHRGFPGLACMEFEVETSKKKKVEFTMGVFLYVDEVK
EKLTGLYYDELEAFSSANIARHLLLYGNILILGEALVYEDQSRTVFEQKLKIPTPYSQFPARETHCHKQNRSGRSNKETLNHESYNVHEHVLSDYINVNEEEVDSNHHLEVVIRSGLGG
FYEPGLEKV CYRTPKNNNGALFLPNFRELSGLAEYPLFMHQRIKRVVTFVEGVNAHGK