SELECT s.sequence_id,
# s.storable,
d.mernum,
oname.name,
s.sequence
FROM organism o,
domain d,
organism_name oname,
sequence s
WHERE d.mernum = ?
AND o.merops_taxonomy_id = oname.merops_taxonomy_id
AND oname.recommended_name = 'Yes'
AND o.merops_taxonomy_id = s.merops_taxonomy_id
AND s.sequence_id = d.sequence_id
AND d.for_internet = 'Yes'
Sequence for MER1168433
>MER1168433 - family C6 unassigned peptidases [C06.UPW] peptidase unit: 243-760 ( active site residue(s): 584,657 ) (Johnson grass mosaic virus) (Source: EMBL nucleotide KX897165)
1 MAGEWNTVIGKRNQRKTEEQRIFDAQKRFYETHQVYDAQRAMLHNSRILKRNFELTGVSE 60
61 IPKHEPKPIKKVFKQVWVAKVKELLNEPKPIDVKPVQARDEVVKIDIGKFARVLLDQCKA 120
121 YKVPVEIVGRKRKIVSKIQPYLKHGKTFLKLETKHEQGSIKRRDISMSDPVKKLVLKIAD 180
181 KYEKPTSTDLETFSNGSSGITFRSDTGMLFIIRGRANGVLVNALDQYEEDLKQIRHYSFD 240
241 VEARAFWKGFTENYMAQRREAHDHTNHEPVMSVEECGKRAAMLENAFHQGFKITCKHCFQ 300
301 TFDEHSDEEVCERIHNALDRIEEQNRIFISTDQALKTSIRVLKDXTDVTRVHHSDCMEVV 360
361 KILEPTLPTPANRIVEIAKSLMKVRVSDELQMVSIGQNLLELAKWFSKRHKAGPSDDLST 420
421 YKNKVAARGVVGNALMCDNQLDKNGDFLWGQRAYHAKRFLSNFYDIVDPSDEYDKHIIRR 480
481 TPRSQRHLAIGKLIVTMDLEKMRSRLVGLPCEPKNIAQHCVSRLNGNIIYPCSCVTQESG 540
541 RPLWSELIMPTKEHISLGNLADPHLVDLPQSDPPQMYIVKDGYCYLNIFLAMLIYVKEDA 600
601 AKDFTKFIRDRIQPMLKEWPTLKDVATACYLTTIFYPETLQAEIPKILVDHETKTMHVVD 660
661 TFGSLTTGYHILKASTVAQLIRFSYNDLVSEMKEYIVGGDLVHGTTVRLIECLIKGIFNK 720
721 SYLQQIIIEEPFLLLLAIESPCVLINMYNNGNFETAMKYYSTRNMPLTNLFAAMESFAKR 780
781 VSKADIFAEQLSIMEQAAYDIHARMAGTYVNDPLAKYVKHHLIVMMNRADMNAQLKAEGH 840
841 TIFDNRTYEIIEKKYANDIQTSWQELSWLEKSRLVSQLYFTKKPQHQCIKPKESTDLGGI 900
901 YNISPMLLVSGFHEKLHTKANSISQKLQSTYNSVKHKFRGGILKTAYRCLPDTIKLMHVA 960
961 IIMSCVSSILLSICAAGTEYKKYKREALREQIEREEQMVEALHAQFMLDNRFSGTEKEFL 1020
1021 MRVEKNFPHLAPRALAMVKVEVEHERKGYTELKLEQVIAFATLLTMLYDADRSDAVYKIL 1080
1081 QKIKACTSICSQEVKHEGSQIDDVQELENLKRLTVDFNIEQEIPPSIAVHDTTFEKWWTT 1140
1141 QITQSRTTTHYRNKGEFLEFSRSNAIVVCNRIAHGSDSKHFLVRGNVGSGKSTAIPRYLS 1200
1201 DKGKVLILEPTRPLTENVCQQLQNEPWCLDPTMQMRGKSIFGSTPITIMTTGFALHLFAN 1260
1261 NVERLSEFKFIIFDECHVVDSNAMAFSCLLEEYKYNGKIISVSATPPGRESEFQTEKEVD 1320
1321 LRVFEEVSFDTFVMEQGTGSKLDAVSVCDSILVYVASYNEVDQMSRLLNEKGYTVTKVDG 1380
1381 RTMNGGNKTGSGLNKHIHVSLNETLQTQIKEHGKHFIVATNIIENGVTLNVDGVVDFGTK 1440
1441 VVADLDVDNRSIVYQKIPISYGERVQRLGRVGRFKKGYAFRIGTTQKGIVDIPAMTATEA 1500
1501 AFLCFAYGLPVITHNVSTTHLSHVTSAQARTMLQFELPIFMMSELVKYDGHMHPAIHEIL 1560
1561 KQYKLRDSSISLRETALPQNASDLWLSVGAYKKLGYRIDLPDDCKIPYYVNGVSAKMYEQ 1620
1621 IWNAVKDFRQTCCMRRMTSSCAGKIAYTLQTDINAIPRTLAIIDGLIKEEQIKHSHFQSM 1680
1681 SSNSTSSYNFSLNGIMDMLRSRYMKDHSVDNIAKLEMVKNQIIEFSNASINYRDVDFIKH 1740
1741 FGALQTVIHENKEGVCKELELKGKWNGELMCRDGIIAAGVAIGGALIGWECFRYYFMTEV 1800
1801 EHEGKSKRSKQKLRFRNARDQKVGREVYGDDATIEHFFGEAYTKKPKKGNKTHGMGFKTR 1860
1861 RFTHIYGIDPTEYDMIRFVDPLTGTTLDESTQADMALVKEHFTNVRESYVENDIIERQHL 1920
1921 YSNPGVHAYFIKNNASNALKVDLTLHNPLALCRTNAIAGFPEYEGELRQTGPSVSVPASE 1980
1981 VPAQNEPDVEHEGTSAIHGVANYNPISDNICLLKNDSDGKNIELYGIGYGAFVIAPGHLF 2040
2041 ESNNGSLHIRSTRGLYKIPNTQALKISAIEGRDIVLIRLPKDHPPFTRSVKFSEPDKYDK 2100
2101 VIMLRMNFQQNKNIVEFSESSIIAQQSASFWKHWISTKPGYCGLPLVNTRTKEVVGIHSL 2160
2161 KAANNSVNYFTSVNADLIGKLALDIETIQWTKGWKYNEHLLAWDGLHLKNSKPSQAFNTA 2220
2221 KEIEVVNERVSNESADTWLSRQFNENLNVVGELPGNLVTKHVVKGKCQLFQLFLSVDEQA 2280
2281 KKFFEPLCGHYSKSLLNRNAFIKDFTKYDKPIVVGTVKPNEFEMATRDVIKMLHNLGMKD 2340
2341 CNYVTIAEEIYGAMNMKASVGALYNGKKREYFANFTDEQKEKLMEESCKRLYSGKLGVWN 2400
2401 GSLKAEIRPMEKILANKTRTFTAAPLETLIGGKVCVDDFNNQFYQNHLKGPWTVGISKFY 2460
2461 KGWDSLMRRLPENWVYCDADGSQFDSSLTPYLINAVLQIRLACMEKWDIGEKMLSNLYTE 2520
2521 IVYTPIATPDGRIVKKFKGNNSGQPSTVVDNTLMLILAFTYSLRVNNIENFEQDDIIKMF 2580
2581 GNGDDLLIAVRPDFEYLLDTFKGHFADLGLNFDFSNRTRNREELWFMSHRGMLKDGVYIP 2640
2641 KLEPERVVAILEWDRSIEPEHRLSAICAAIIESWGYEELTYQIRRFYQWVLEQEPYKELA 2700
2701 LQGKAPYLSETALRKLYLDESCDQSELLHYYEEMYKNAVTSEDVIDVEHQSGNEDAGRQK 2760
2761 SSTNQSTSGTGTPTQTTATADNTPASNNTSNTQGNSQNTQGTSQTQGTSQNTQGTAQTQG 2820
2821 NGASGGTNTTTAQKDKDVDAGSGGTFMIPKLKKVSPKMRLPMVSNKAILNLDHLITYKPD 2880
2881 QRDISNARATHTQFQFWYNRIKKEYDVNDEQMRILMNGLMVWCIENGTSPDINGYWTMVD 2940
2941 GNSQSEFPLKPVVENAKPTLRQCMMHFSDAAEAYIEMRNLDEPYMPRYGLLRNLNDKSLA 3000
3001 RYAFDFYEINSRTPNRAREAHAQMKAAAIRGATNHMFGLDGNVGESSENTERHTAADVSR 3060
3061 NVHSYRGAKI 3070