SELECT s.sequence_id,
# s.storable,
d.mernum,
oname.name,
s.sequence
FROM organism o,
domain d,
organism_name oname,
sequence s
WHERE d.mernum = ?
AND o.merops_taxonomy_id = oname.merops_taxonomy_id
AND oname.recommended_name = 'Yes'
AND o.merops_taxonomy_id = s.merops_taxonomy_id
AND s.sequence_id = d.sequence_id
AND d.for_internet = 'Yes'
Sequence for MER0159778
>MER0159778 - family I32 unassigned peptidase inhibitors [I32.UPW] inhibitor unit: 801-931 (Drosophila simulans) (Source: EMBL nucleotide XM_002103952)
1 MTTRLAPQRQFILSTRSAIVDATSPPEDSAEEQQQLTVEVESATNGVIGGSTTNSTTSPP 60
61 PHAEQFEFCTEDGVVVSATLEDVMTQVKLLPLLQNCQLLQKKLVDEDDDSTGAVATDADQ 120
121 LEVIRVVLPMDAEDSTSDAHLHGHVVNSSSDTMGTITTTEPNGTTVTHSIPIHSMADLAA 180
181 IKDGVDLAQQVANGQVTVVQTTEDDDGTPFITVTVSGQEQNYQVQYVDSELYHSNSSQTQ 240
241 MTYPFCPVGDYQGNGQTAYYSTAGQYGATSSAGGSSNGAHSTTLPYLVPVEEGILLNGSA 300
301 HSLSQSQSQSHGRDSPHSLTEVAYIQEAQSTPQTPTSTTTTHSASGGSLGTGGGGASPDS 360
361 DQSALGSSNKIASATIKWLSRNYETADGVSLPRSTLYNHYMQHCSEHKLEPVNAASFGKL 420
421 IRSLFSGLRTRRLGTRGKSKYHYYGIPHQARLVAEQPGDGRQADADRRLRTILGRIRRTG 480
481 QRTDGQRHQQHCRTAGRLQWIGRWPWPATQQRHQEAHLQAGNLRGVHSVHRRWNQCSALV 540
541 SAHRAEPQLQQRTDPGGRGHLPGPVPGALRVLPGRRTQPGVQHCGVPAARLLAGQRQQQS 600
601 GRVRGGEVLEQDEAVSVVPLRRSAEVRARGDSIVNGRYMPLQDKILFWDGHNLGLRGDYN 660
661 GVLLLDTILQPPIGQNDDYIKLEIILSEAIIFQNCITELESEGLECPCDISNELTQKINQ 720
721 AQMNAKKGIKAQRWNTICLEVPYSSLKLVSNNMVILLKRLERHIPVLAIASAINERLTDM 780
781 MMGSRVPDFGWNFSNFQRVLMHSEAVRRQTFEKWPHMDYKWALPDQMAQAGFYHQPSSSG 840
841 EDRAMCFTCNVCLVCWEKTDEPWSEHERHSPLCPFVKGEYTQNVPLSITYATNPALPAPG 900
901 LGFDIISNSDYANVLCTSCSQTGELSVWSIERHLKLMHSFHVPTLLNYVFEESFEWARVT 960
961 AICVLPNARARTKVNYVYSAANYGGTGSSNGAGCNSGLNAVSGGKFGSVNAQHITSTSTL 1020
1021 RAGVVGSKIVLGVSVRQSSGELALRMVVLNIVEVDRNSETSTSGSNDSGSVSSGGGQLMK 1080
1081 SSSPMVNVSAENNATVTQVNLESKDDDNKAMTPYEKFADGFDSNGFVSALMTYNKNNGVS 1140
1141 QNTDDASALYDFDLCTLSQILDHNLEEPLSLMVGSSNTVNVSNIGMGNEINKLVVDVEIT 1200
1201 HQNNNNNNNNNESNSLGGNSSNNNNNIMINGGTNNTIDKMAAIEEIDCVVESWTSVKRMN 1260
1261 ALDGASSGVNGANHMAQEVIEIAEILPTTPKCNQLLVKLLRTKAPEAEGSKIIMATVAKE 1320
1321 EEEEDEEQRTDESMETDNNAEGNVAAQLLVFDYDDTEISNDYTLAMTFSRAKFPKQLCIL 1380
1381 PHFNSSPEHKDAGSICVVCADGTVEIYSLADFQGTMVIEEEGEHFESVVYCRNLDRLCCC 1440
1441 SRQGGLLFYSLSEGENDSGDELLEMDDDCSTTLTQAADVSVTDGGRQLGGTDLLGKTLLA 1500
1501 NESICMDVGSEAAAIPNSSSAAQGAHVQTSPSAASAPSTNANLLAYKTADLTLEDLKVFY 1560
1561 ALTQFDDKLTVYSAEVPSCWNDLGQVQNQRKQSQNMRHGGDERDFTRTWRLHNDATTWDE 1620
1621 HIIEINLAQPVSLGHIDLKFTVYQQCSNPAAIQVTLLKQNNNGFGYRMKGPHSSYKPNVI 1680
1681 DDNIDLSYIANENPVLSEEYLLAHNAEVLAGPIELSSCIDLCDQGGTATLTSPKLFKTRT 1740
1741 RNFLLHIKTVSDPSKDGQNKTRAANIQDLLAQQFECISLAEKHIEQLLRNCVIYSERSTA 1800
1801 HKCVKLLIMLTEIFWMRTSSSGTMMSHPLMTRPVQWKLLSRKHGIFSATILAGPTICKHL 1860
1861 HDLLLWLHSKSETSGIPCKRRLKDILLHVVLQLVQPGGSISNQQGPIDAQNQLVRDLLMI 1920
1921 PHDKGDLNIALKITESVSFLVYNNISNGEKLQCQRGNENSPVGNNFSNLFANVLGSENPS 1980
1981 KQNAAICDNSLIINLLKLSSHMVLTEMPRQPSEVTIPEEEELSNQSQTDETKAEQLNTEG 2040
2041 HRSKVPCIADWVLRHFPTMKRLFGTLSQCSTNTFTMMSSGCFFSPKSNMILDDPQTIADA 2100
2101 VFSLMITLNDKASHPRLVVAPICQYLEETTIQRNATLPRLPLSEPFLWYISKVLEVTAAV 2160
2161 QTFTQLGGIQIICHNLVRLNKTIINMQPGLISLIMQHLTRNTRFKRNNHVAASSACKKTT 2220
2221 TGTGTTCPTSAQPPRSAAQYDGLINFAPFSHIVSENDATQSAEVLISNPNNSHRRPRSPA 2280
2281 WTYMFYPNETHVDLTITLPTAILLKEVQLVPHTTSLASCPSAVALELSRDYGLGSIPVGA 2340
2341 PMATTGLTCIRLKLAKAEVATSIVLRLYKPKDCGNVGLVQIAVLGQTIFGNRMHGLRSPN 2400
2401 PFIDSLATCSSPVQTAVLAAMDADSMLEDDAFAKTSIGWVRILSRCFHVAALQPDSKLAD 2460
2461 LIAAYPAAYPGFLEACCSLLNIMPMIPSLAQQHLETILLKLSAYNHEISLQLLRTLLWHT 2520
2521 TPQVFKLSSDSVCDLIYEVVTGSTEHLLDKLRVLIDWVMQLHDNYSKQARCNNPQSGFVK 2580
2581 VIASILWKVHTQQQLPELPLLISSSLFETCFEWVSSLEHDEPLKCSFDSLLCALCFIKPE 2640
2641 LFNQLLVKLGVKLEPPARGQTDDSKVQSGSAWFRREGSENLSVLLQRPTFLKTLALACQS 2700
2701 PAAVYQMLDSGLPKLLAHGINEYCMHLMPGSEPVASAATVTVPEDETLANNQAAAAADDE 2760
2761 DSSLTDFDKAEANVVHNTPLLSSSNVPKVLDFFAECCAEGPMRDWLGTMQGSVFWKPLLQ 2820
2821 LLCNTHAAQFSKTLPKEQSFIRLERATINFFTRVSACHPGNQEVLTSLLIGAIICKPLRF 2880
2881 SHGVRPTISGFTRQMVLQLLLENEHITVSVRSQQPLQRRDTLSAILGGISSGASTSLPVA 2940
2941 AVNNHPARRSSAHHMLFTVTTSTTCQEVMQNCVNVFSNLVYQQPTDQRAGEASASSSGVS 3000
3001 SATAKSSESKMEKSSFLNFNNVESGSMEFLTVGAAVAAKDKRIKDAKNQAAMNKDKETQT 3060
3061 SSTNLASNIFNVEEFLLQTANAASGNRLVIPEYSDIVLAGDATISQVLASLQNAGHSLST 3120
3121 PCISFDLVLQQRSDDTSEAKKTKAACTEPLPSPLQRFSTSGGLSLLAHYLPTVYPEHSGR 3180
3181 KTTLVYSEKEKSPPLSDWVKLEPNDEIYEDLEDTLCEPAAKLATVSSVPQHSLAAFGLFL 3240
3241 RLPAYSDVLLRDKMRAQCLLRLVLGVTGDGDGNDIYSLPLAPSLPTLPFEVFRQLLDSVP 3300
3301 LSTDDGVLLRRVVIEVGAMHLVLNCLGIFSHQSHNNRIGAPISDPSPSGTSSGSGTIGNG 3360
3361 SGNGSVSGTKTNAPEEATPSATSDDKSHMYWAKGTGFGTGSTTQSWNVEQALLRQKSEEE 3420
3421 HVTVLLLVLASYINPGDCIPSEMCGEDILAYHDVRDVTGELPPIFQTLLQQSCLIPALSS 3480
3481 YLRNDSVLDITRHIPLYRAILKLLRALSLSKTLVSLLQPSASGSGDSTPPIVELLTSMKT 3540
3541 CVDTYAKRLKVNKKSNIKGQTHQLTFNIDDGDDEGLALLIPDIHETSVLVQKTTDADALI 3600
3601 NMLHTNEDGSAQIEPVSKSIEQRYLELMKKRQFDTFDMIVESDNNSFRFVVSHHFEKMVR 3660
3661 LAGDRYHPSRVKRLAQEAVTLSTSLPLSFSSSVFVRCDTDRLDVMKVLITGPADTPYANG 3720
3721 CFEFDVFFPPDYPNQPMLINLETTGRHSVRFNPNLYNDGKVCLSVLNTWHGRPEEKWNAQ 3780
3781 TSSFLQVLVSIQSLILVPEPYFNEPGFERSRGSPSGTNSSREYNSNIYQACVRWAMLEQI 3840
3841 RSPSQCFKDVIHKHFWLKREEICAQIEGWIEELGKPQYTERASRTISFNSMVLRRHYRHL 3900
3901 REELSKLKPPRGLEDLDAPFNPVATLPPMDVSAVAPSLAAKNTVQAEPDDAIVTDITQLS 3960
3961 ENADECEADGDAEGDGDVDDGFKGFPQEEGLLTGEEEVVEILSDTENESSVWQ 4013