SELECT s.sequence_id,
# s.storable,
d.mernum,
oname.name,
s.sequence
FROM organism o,
domain d,
organism_name oname,
sequence s
WHERE d.mernum = ?
AND o.merops_taxonomy_id = oname.merops_taxonomy_id
AND oname.recommended_name = 'Yes'
AND o.merops_taxonomy_id = s.merops_taxonomy_id
AND s.sequence_id = d.sequence_id
AND d.for_internet = 'Yes'
Sequence for MER1168423
>MER1168423 - family C6 unassigned peptidases [C06.UPW] peptidase unit: 238-760 ( active site residue(s): 579,652 ) (sugarcane mosaic virus) (Source: EMBL nucleotide KY006657)
1 MAGSWTHVSYKWQPNVNNDRDVRKVMEMFAAKHQHYTEEQRLAHNSKLLRKAYVVDVEPV 60
61 KPAPEPIRRKVWVEKFDHNPTEDLVYPRLVTVKKAAEMKPVNTSINKLIRDVLDISKGSS 120
121 LKLELIGKRQKCKTQLAIKKYNNKDYLHCRTRHEDNMFKRRDVAIGIEWVPTIEAIARCY 180
181 STVNKQEMQSLYKGSSGLTFMQNDELFIVRGRMNGELVNSLEENRNVLDIDHYADPQAND 240
241 FWRGYTDAYVANRSISTTHTEHTPTINLEECGKRMALLEILFHSTFKITCKTCNIDDLEL 300
301 SDDEFGAKLFRNLQRIEEQQREYLAKDQKLRRMIQFIKERCNPKFSHLPLLWQVAETIGH 360
361 YTDNQSKQIIDISEALIKVNTLTPDDAVKASVALLEVARWYKNRKESLKTDTLDSFRNKI 420
421 SPKSTINTALMCDNQLDKNANFVWGNREYHAKRFFSNYFEAVDPTDAYEKHVTRFNPNGQ 480
481 RKLSIGKLVIPLDFQKIRDSFVGLSINKQPLTKACVSKIDGGYVYPCCCVTTEFGKPAYS 540
541 EIIPPTKGHITIGNSVDPKIVDLPNTTPPSMYIAKDGYCYINIFLAAMINVNEDSAKDYT 600
601 KFLRDELVERLGKWPKLKDVATACYALSVMFPEIKNAELPPILVDHESKSMHVIDSYGSL 660
661 SVGFHILKASTVGQLIKFQYESMDSEMREYIVGGTLTTQTFNKLLTSLAKNMFKPNQIKQ 720
721 MIEEEPFLLMMAIASPTMLIALYNNCYIEQAMTYWIVKNQGVAAIFAQLEALAKKTSQAE 780
781 LLVQQMQILEKASNQLRLAVTGLNHVDPAKRLLWSHLEAMTTRSEMNKELIAEGYALYDE 840
841 RLYALMEKSYVDQLNQSWAELSFCGRFSAIWRVFKVKKYYKPSLTVRKSVDLGAVYNISA 900
901 THLISDLAQRSRDRVSSTLTKLRNGFYDKLEKARTRAIKTVYWFIPDIFRLMHIFIVLSL 960
961 LTTVANTIIVTMNDYKKLKKQQREDEYEAEINEVRKIHANLMKEHNDNLTCEQFIEHMRQ 1020
1021 THPRLIEATLELTHTGVIHEGKSNLETNLEQAMAVGTLLTMILDPQKSDAVYKVLNKMRT 1080
1081 VISTFEQNVPFPSINFTNILTPSVAQQSVDVDEPLTLSTDKNLTIDFDTNQDLPADTFSN 1140
1141 DVTFEDWWANQISNNRTVPHYRLGGKFVEFTRENAAHVSIELAHSNLEKEFLLRGAVGSG 1200
1201 KSTGLPYHLSMRGKVLLIEPTRPLAENVCRQLQGPPFNVSPTLQMRGLSSFGCTPITIMT 1260
1261 SGFALHMYANNPDKISDYDFIIFDECHIMEAPAMAFYCLLKEYEYRGKIIKVSATPPGRE 1320
1321 CEFSTQHPVDIHVCENLTQQQFVRELGSGSNVDATKYGNNILVYVASYNDVDSLAHALTE 1380
1381 LHYSVIKVDGRTMKQNTTGIVTNGTSQKKCFVVATNIIENGVTLDVDVVVDFGLKVTAEL 1440
1441 DVDNRAILYKRVSISYGERIQRLGRVGRNKPGTVIRIGKTMKGLQEIPAMIATEAAFMCF 1500
1501 AYGLKVITHNVSTTHLAKCTVKQARTMMQFELSPFVMAELVKFDGSMHPQIHEALVKYKL 1560
1561 RDSVIMLRPNAIPKVNFHNWLTARDYNRMGCSLELEDHVKIPYYIRGVPDKLYGKLYDII 1620
1621 LQYSPTSCYGRLSSACAGKVAYTLRTDPCSLPRTIAIINALITEEYAKRDHYRNMIANPS 1680
1681 SSHAFSLNGLVSMIASRYMKDHTKENIDKLIKVRDQLLEFQGMGMQFQDPSELMDIGALN 1740
1741 TVIHQGMDATAACIGLQGRWNASLIQRDLMIAGGVFIGGILMMWSLFTKWGTINVSHQGK 1800
1801 NKRSRQKLKFKQARDTKYAYDVAGSEETLGENFGTAYTKKGKGKGTKVGLGVKQHKFHMM 1860
1861 YGFDPQEYNLIRFVDPLTGATLDEQIHADIRLVQEHFDIIREEAVANDTIERQHIYGNPG 1920
1921 LQAFFIQNGSANALRVDLTPHSPLRVVTNNNIAGFPEYEGTLRQTGTALTVPVNQVPAAN 1980
1981 ETGVAHESKSMMSGLGDYTPISQQLCLVQNDSEGVKRNVYAIGYGSYLISPAHLFKYNNG 2040
2041 EITIKSSRGLYKIRNSVDVKLHPIAQRDMVIIQLPKDFPPFPMRLKFSTPSRDVRVCLVG 2100
2101 INFQQNHTTCIISESSVTAPKGNGDFWKHWISTVDGQCGLPLVDVKNKHIVGIHSLASTS 2160
2161 GNTNFFVAMPENFNEYISNLVQTNKWEKGWHYNPNLISWCGLNLVDSAPKGLFKTSKLVE 2220
2221 DLDMSVEEQCKVTETWLTEHIQDNLQVVAKCPGQLVTKHVVKGPCPHFQLYLSTHDEAKL 2280
2281 YFSPLLGKYDKSRLNRAAFIKDLSKYAKPIYIGEINYEIFEKAVERVISILRSVGMLQCT 2340
2341 YVTDEEEIFNSLNMNAAVGALYTGKKKDYFKDFSNDDKAEIIMRSCERIYNGQLGVWNGS 2400
2401 LKAEIRPIEKTILNKTRTFTAAPLETLLGGKVCVDDFNNQFYSHHLEGPWTVGITKFYGG 2460
2461 WNRLLEKLPEGWIYCDADGSQFDSSLTPYLINAVLHIRLHFMEEWELGAQMLRNLYTEIV 2520
2521 YTPIATPDGSVIKKFKGNNSGQPSTVVDNTLMVIIAFNYAMLSSGIPEDKIDDCCRMFAN 2580
2581 GDDLLLAVHPDYAYILDGFQNHFGNLGLNFEFTSRTKDKSELWFMSTQGVKCEGIYIPKL 2640
2641 ERERIVAILEWDRSNLPEHRLEAICAAMVEAWGYPDLVHEIRKFYAWLLEMQPFANLAKE 2700
2701 GMAPYIAETALRNLYLGTGIKEEEIEKYFKQFVKDLPGYVEDYNEEVIHQSGHVDAGRQG 2760
2761 GSGGQGGTPPAGNGGQQGSGGNGGGQTGGSGGTGSGTQGNGGQTGPQGSGGQQGSGGNGG 2820
2821 GQTGGSGGTAGQRDKDVDAGSSGKISVPKLKAMSKKMRLPKAKGKDVLHLDFLLTYKPQQ 2880
2881 QDISNTRATKEEFDRWYDAIKKEYEIDDTQMTVIMSGLMVWCIENGCSPNINGNWTMMDG 2940
2941 EEQRVFPLKPVIENASPTFRQIMHHFSDAAEAYIEYRNSTERYMPRYGLQRNLTDYSLAR 3000
3001 YAFDFYEMTSRTPARAKEAHMQMKAAAVRGSNTRLFGLDGNVGETQENTERHTAGDVSRN 3060
3061 MHSLLGVQQHN 3071