SELECT s.sequence_id,
# s.storable,
d.mernum,
oname.name,
s.sequence
FROM organism o,
domain d,
organism_name oname,
sequence s
WHERE d.mernum = ?
AND o.merops_taxonomy_id = oname.merops_taxonomy_id
AND oname.recommended_name = 'Yes'
AND o.merops_taxonomy_id = s.merops_taxonomy_id
AND s.sequence_id = d.sequence_id
AND d.for_internet = 'Yes'
Sequence for MER0169481
>MER0169481 - family C50 unassigned peptidases [C50.UPW] peptidase unit: 2049-2373 ( active site residue(s): 2101,2176 ) (Toxoplasma gondii) (Source: EMBL nucleotide EQ970683)
1 MCVAINLRNVPQTHSWSSPLVAHLFSRPLPSLSLLFSFLLGQRTGLSRRSLPMRRLLEKQ 60
61 GERRETSRSDEEEAEAWRAEGTVKPRDKQESRICLRLSTMRLSRTFLDVALWGCKQLSHS 120
121 RIFSCPSSDCQSSSRFPTSSSRLYAGEPPRMSSSVCLPRRRQLLRLALEVLAEHSLLHPS 180
181 SLSSCSSSPSAASSSPSCFSPSLSPSSSSPLSRLLGHLFVALLQRMPALASARQREGSSV 240
241 SQALPVLQETQHDGDLSCSLVAERTAVASGDDLQFLLAVCALCVAVRLTDAVGIRESACV 300
301 LVDCLRAVKKELEQSGANSEFPLTDRDDDLRETTEENEEVSCAVLTLLQATIPLCCGGEA 360
361 LALKLLHRIEERRILSLLSVPSPSSVPRRSSTEDRQLGKDNEAFFQEARDSEGRERTAVC 420
421 VGGSGSLAFLATVVHRFLAFSSQRTGTRPRSRRAHHIENTLFLPTQPFLFSPSYVDHNPV 480
481 RDEERNRSRGCERQRGDEATEVREKGDREKGDREREDREKGDTEREDREADASRLLSGAD 540
541 GVHLSPVSPRDTDVPQRPDTEPAPSLSFPPSLRLSRISFPAILTRASPSSGDLAPLGWSS 600
601 VFLSLSANRRACVLARSIPARIAAALAAGAETVFAEETESQSGERHCRGSKAKAGECGGA 660
661 TVSSAKAKKQKFWSPLGEAGDSERSQPDGICPRKLKKPLPCQSGRQVQGYDRSEEESGLW 720
721 IIYYVSENDCLGSIETDSQSCRVKRCKSRVHPTLPVSPSPPSPSPCFSSCSSSCDSACSS 780
781 CSSDSSCSATSSATSFPSLLRQFQWLLWVLSLTAGQTIQTFSQRAASPCVSSSLSSSVSS 840
841 SVSSSLSCSPAAASPPAYREDVQRTQVLAQWWKQRRELEAEFSRWVGRLERRLGLALLLL 900
901 RGWPSFSSSFPSASSPSSSSLSERTSRSAPSFSLTREGERKEERLLEALRFCGVLLARWL 960
961 ASWAADEGDSSREEAGERREGEKGAWRQTSAANSGRLLRPYKRPRLLLPLRSFLFQRETG 1020
1021 SRDRRADRVRDQRRRSGEQILASLAQFAFALASLKLIVRCTERKGDPPFKIQDWHLPDGD 1080
1081 RRTASQRFPSRLSPASPSALSSSRAAPASPSPWRGGDCPQGERRRLEMRGGEDSKASRNG 1140
1141 RQQAQSEKEARREPWVRILGSGATAEGRGRSLTDLFRDEMMVIQGGAFDFSLDDLGDFLR 1200
1201 THVLQPLSTSPGRKGPSPLAELKQAGGLIPPSGLFETVSSMQAQTHPESRKSEERRRTDW 1260
1261 KGRDTGAADLTAAARYESTGGKDGGEGSVDEGSESDEGQLWRVLAWTFLTEVVAVLATRF 1320
1321 FASQTRTATASRASSSDDSLAFPPSLPSRLSSSPLVSSASTRCSSRSPSASGENCGRRRY 1380
1381 REVSEHGAARLDESKTVSSVWSPLPGCLPSSRPVAPPSLHSASERGTKGQCGAPKGPACG 1440
1441 EAGARTVRERGATVDECLQCTRENRGEAVNGAHTQSLSRLLAVETKPELLLRESEALDPF 1500
1501 LVEDPSKPAGESGELRLFFGGAEKPRSQCPNGDSYAVFEGGASDATEGDTYPSIQQRLQP 1560
1561 RSAPPRTEVETERVRGEADLQVNARRRERRFFGHPHRRGRSPFAANASPRCEQATSLQMP 1620
1621 SLRAILARPPHSRTPQEVKERDEKVEGMPGRDAVREAERGEGRAAEREEQGETEDGEEWL 1680
1681 VATEPVVVYADPFFSQLPLEALPALRLQRLCRGGSPFVTSFLLSQLWARQLSPSQARLSV 1740
1741 ATAGPPPFASSPCKPPDRLCATSRGASPSPATFAYLKSETDGKQTRHEADDAPGCLQRQD 1800
1801 ALEDRATEDGDTEKTHERKRRKRDTREVHEGRNGDGEETLKVRCGVARQSLLAPGCLSRN 1860
1861 LCFVSLAPRTQDRLSGDRAASLRKSSLHRDAGGLALSLFDLDLEPYRQLCCVEAATEAAR 1920
1921 SNEGHAFKKNRRACVENPRRGARVSWPSERRSGDSWREENGQDLPKRRREGDALSLPTGR 1980
1981 ERGFRSSDCRERVKEGAGDDLLEKRQTSEERAMCRKQETQRASVRAFRLRLGARGAVLSA 2040
2041 SKSRVAFSVNPSGDLPRTSRVCLPFLLAGGASWTGKLGAALTENEWLFSLLTADVFLYCG 2100
2101 HQGGEQYIHRDLIQRAFLLKESVSYQLPSLSPSPLSSPPLSSSSSLSSSLDSSLSSPSSR 2160
2161 SPYLCGLRAAALLFGCSSVRLTSFGPLSPPWSFAFDFLIGGSPLVVGNLWGVTDVEADAI 2220
2221 TKSLLWKWTQARASPFIGRVERPAASAFSRGAGKNAGNNATEHGSNAGTRAPAAPRAQPR 2280
2281 NFREEIAQTDSNKRKGREADEQEGADATEEDSEADEDDETDEEDETDEEEREERRDCLCS 2340
2341 SVRLTLTEAINEAKQACRLRLSTGAAAVAFGLPL 2374