Query 001599
Match_columns 1047
No_of_seqs 470 out of 1427
Neff 7.4
Searched_HMMs 46136
Date Fri Mar 29 04:48:30 2013
Command hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/001599.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/001599hhsearch_cdd -cpu 12 -v 0
No Hit Prob E-value P-value Score SS Cols Query HMM Template HMM
1 PLN03202 protein argonaute; Pr 100.0 7E-170 1E-174 1579.1 83.5 811 195-1047 27-900 (900)
2 KOG1041 Translation initiation 100.0 2E-150 4E-155 1391.1 72.3 813 199-1047 43-876 (876)
3 KOG1042 Germ-line stem cell di 100.0 3E-116 6E-121 983.6 53.5 713 206-994 87-832 (845)
4 cd04657 Piwi_ago-like Piwi_ago 100.0 1.1E-99 2E-104 887.0 40.4 408 566-992 1-426 (426)
5 cd04658 Piwi_piwi-like_Euk Piw 100.0 1.5E-92 3.3E-97 834.8 43.9 427 534-989 2-447 (448)
6 cd02826 Piwi-like Piwi-like: P 100.0 2E-85 4.4E-90 760.6 40.2 374 579-990 2-393 (393)
7 PF02171 Piwi: Piwi domain; I 100.0 3.1E-69 6.8E-74 607.1 24.1 287 697-993 1-302 (302)
8 cd04659 Piwi_piwi-like_ProArk 100.0 2.9E-44 6.2E-49 419.2 21.0 264 693-989 109-401 (404)
9 PF02170 PAZ: PAZ domain; Int 99.9 6.6E-23 1.4E-27 203.0 10.4 133 408-545 1-135 (135)
10 cd02846 PAZ_argonaute_like PAZ 99.8 1.4E-20 3E-25 180.8 13.3 113 408-521 2-114 (114)
11 cd02825 PAZ PAZ domain, named 99.8 5.5E-20 1.2E-24 176.5 11.7 112 407-521 1-115 (115)
12 cd02845 PAZ_piwi_like PAZ doma 99.7 1.9E-17 4.2E-22 158.5 9.2 106 408-522 2-115 (117)
13 PF08699 DUF1785: Domain of un 99.5 9.7E-15 2.1E-19 118.3 2.4 52 355-407 1-52 (52)
14 cd02844 PAZ_CAF_like PAZ domai 99.4 2.6E-13 5.7E-18 132.7 6.4 84 435-522 27-133 (135)
15 PF12764 Gly-rich_Ago1: Glycin 99.3 1.9E-11 4.1E-16 108.8 8.8 98 88-193 4-103 (104)
16 COG1431 Argonaute homolog, imp 99.2 1.4E-10 3E-15 132.3 16.7 303 637-990 355-668 (685)
17 cd02843 PAZ_dicer_like PAZ dom 98.4 3.3E-07 7.1E-12 86.9 5.7 67 437-506 39-106 (122)
18 KOG1596 Fibrillarin and relate 94.1 0.21 4.6E-06 53.0 8.5 6 307-312 184-189 (317)
19 PF12764 Gly-rich_Ago1: Glycin 89.8 0.4 8.6E-06 43.9 3.9 46 126-171 41-90 (104)
20 COG4371 Predicted membrane pro 87.0 1.1 2.4E-05 47.5 5.6 16 165-180 155-170 (334)
21 PF13032 DUF3893: Domain of un 86.5 1.2 2.7E-05 44.2 5.4 56 935-994 67-122 (138)
22 smart00157 PRP Major prion pro 84.1 5.3 0.00011 40.8 8.5 11 227-237 158-168 (217)
23 PRK11617 endonuclease V; Provi 83.1 31 0.00067 37.2 14.4 39 947-992 179-217 (224)
24 KOG4307 RNA binding protein RB 80.5 19 0.00041 43.9 12.6 12 215-226 869-880 (944)
25 cd06559 Endonuclease_V Endonuc 77.5 61 0.0013 34.6 14.4 172 772-986 23-207 (208)
26 PF05642 Sporozoite_P67: Sporo 58.6 2.5E+02 0.0054 34.1 15.0 20 529-548 587-606 (727)
27 KOG3915 Transcription regulato 52.2 59 0.0013 38.0 8.5 12 510-521 371-382 (641)
28 COG1515 Nfi Deoxyinosine 3'end 51.0 2.3E+02 0.0051 30.3 12.1 123 855-988 80-211 (212)
29 PF04493 Endonuclease_5: Endon 48.1 75 0.0016 33.9 8.2 31 948-985 175-206 (206)
30 KOG3915 Transcription regulato 41.7 1.1E+02 0.0023 35.9 8.5 11 225-235 182-192 (641)
31 PF01949 DUF99: Protein of unk 37.4 91 0.002 32.8 6.7 163 775-988 4-181 (187)
32 PF07555 NAGidase: beta-N-acet 29.2 4.9E+02 0.011 29.6 11.3 105 645-754 18-147 (306)
33 PLN03138 Protein TOC75; Provis 27.2 46 0.00099 42.4 2.9 20 509-528 364-384 (796)
34 PF05387 Chorion_3: Chorion fa 26.4 2.5E+02 0.0054 30.3 7.6 49 175-231 134-183 (277)
35 KOG3875 Peroxisomal biogenesis 25.5 2.6E+02 0.0057 31.4 7.9 18 508-525 317-334 (362)
36 KOG3123 Diphthine synthase [Tr 25.5 89 0.0019 33.0 4.1 48 693-745 130-177 (272)
37 KOG1924 RhoA GTPase effector D 25.4 3E+02 0.0064 34.8 9.0 23 203-226 627-649 (1102)
38 PF04094 DUF390: Protein of un 24.3 3.6E+02 0.0077 33.9 9.4 10 870-879 795-804 (828)
39 KOG0037 Ca2+-binding protein, 24.0 1.6E+02 0.0035 31.5 5.8 12 167-178 56-67 (221)
40 PF00763 THF_DHG_CYH: Tetrahyd 23.3 2.9E+02 0.0063 26.5 7.1 58 692-751 27-85 (117)
41 PF05642 Sporozoite_P67: Sporo 22.3 9.2E+02 0.02 29.6 11.9 20 742-761 694-713 (727)
42 PF04094 DUF390: Protein of un 22.1 3.9E+02 0.0085 33.5 9.1 10 406-415 368-377 (828)
43 PRK14192 bifunctional 5,10-met 20.3 3.4E+02 0.0074 30.5 7.9 64 693-759 32-99 (283)
No 1
>PLN03202 protein argonaute; Provisional
Probab=100.00 E-value=6.7e-170 Score=1579.15 Aligned_cols=811 Identities=38% Similarity=0.648 Sum_probs=689.6
Q ss_pred CCCCccCCCCCCCCCCCCcceEEeeeEEeecC--CCceeeeEEEEcCC----cccchhhHHHHHHHHHHHHhhccCCccc
Q 001599 195 SSKSVRFPLRPGRGSTGTRCIVKANHFFAELP--DKDLHQYDVTITPE----VTSRGVNRAVMEQLVKLYRESHLGKRLP 268 (1047)
Q Consensus 195 s~~~~~~p~RP~~Gt~G~~v~l~aN~f~v~~~--~~~iy~YdV~i~pe----~~~k~~~r~i~~~l~~~~~~~~~~~~~~ 268 (1047)
..+...+|+||||||.|++|.|+||||+|+++ +..||||||+|+|+ +.+++++++|++++++++... +.+..+
T Consensus 27 ~~~~~~~~~RPg~Gt~G~~i~l~aN~f~v~~~~~~~~ly~Y~V~i~p~~~~~~~~~~~~~~i~~~~~~~~~~~-~~~~~~ 105 (900)
T PLN03202 27 SKPKRLPMARRGFGSKGQKIQLLTNHFKVSVNNPDGHFFHYSVSLTYEDGRPVDGKGIGRKVIDKVQETYSSD-LAGKDF 105 (900)
T ss_pred cccccccCCCCCCCCCCCEEEEEeeEEEEeccCCCCcEEEEEEEeccCCCCcccchhhhHHHHHHHHHhhHHh-hCCCce
Confidence 34444678899999999999999999999975 56799999999964 445667889999998766443 444467
Q ss_pred eeeccceEEecCCCCCCCceEEEEEecCCCC------------CC----------CCCCcEEEEEEEEeeeeChhhHHHH
Q 001599 269 AYDGRKSLYTAGPLPFLSKEFRITLLDDDDG------------QG----------GQREREFKVVIKLAARADLHHLGLF 326 (1047)
Q Consensus 269 ~yDG~~~lys~~~Lp~~~~~~~v~~~~~~~~------------~~----------~~~~~~~~V~i~~~~~i~l~~l~~~ 326 (1047)
||||+++|||..+||++..+|.|++.++++. .+ ..+.+.|+|+|++++++++.+|.+|
T Consensus 106 ~~Dg~~~l~s~~~L~~~~~~~~v~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~i~~~~~i~~~~L~~~ 185 (900)
T PLN03202 106 AYDGEKSLFTVGALPQNKLEFTVVLEDVSSNRNNGNGSPVGNGSPNGGDRKRSRRPYQSKTFKVEISFAAKIPMQAIANA 185 (900)
T ss_pred eecCccceEECccCCCCCceEEEEecccccccccccccccccCCccccccccccccCCCceEEEEEEEccccCHHHHHHH
Confidence 9999999999999998767788887542111 00 1246889999999999999999999
Q ss_pred hccCCCCChHHHHHHHHHHHhcCCCCC-cccccccccCCCCCCcccCCCCeEEeecceeeeeccCCeeeeeeecccceee
Q 001599 327 LQGRQADAPQEALQVLDIVLRELPTTR-YCPVGRSFYSPDLGRRQPLGEGLESWRGFYQSIRPTQMGLSLNIDMSSTAFI 405 (1047)
Q Consensus 327 l~~~~~~~~~~~lq~Lniilr~~~~~~-~~~~Gr~ff~~~~~~~~~l~~Gle~~~G~~~Svr~~~~~l~LniD~s~~~F~ 405 (1047)
|.+.....+.++|||||||||+.++.. ++.+||+||+++.....+|+.|+|+|+||++|||+++++|+||||+++++||
T Consensus 186 l~~~~~~~~~~~iq~lnivlr~~~~~~~~~~~gr~ff~~~~~~~~~l~~gle~~~G~~~Svr~~~~~l~LnvDvs~~~F~ 265 (900)
T PLN03202 186 LRGQESENSQDALRVLDIILRQHAAKQGCLLVRQSFFHNDPKNFVDLGGGVLGCRGFHSSFRTTQGGLSLNIDVSTTMIV 265 (900)
T ss_pred HcCCCCCCcHHHHHHHHHHHhhhhhhCCCceeccccCCCCCcccccCCCceEEeeeeeeEeeeccCceEEeeeeeeeeee
Confidence 999988888999999999999988765 8899999998654445679999999999999999999999999999999999
Q ss_pred cCccHHHHHHHHhcCCCCCCCCChHHHHHHHHHccceEEEEeecCCcCceEEEeccCCCCCcceeeeecCC--------C
Q 001599 406 EPLPVIDFVQQLLNRDVSSRPLSDADRVKIKKALRGVRVEVTHRGNMRRKYRISGLTSQTTGELTFPVDES--------G 477 (1047)
Q Consensus 406 ~~~~l~d~~~~~~~~~~~~~~~~~~~~~~l~~~L~gl~V~~~~~~~~~r~~~I~~i~~~~a~~~~F~~~~~--------g 477 (1047)
++++|+|+|.++.+... ....++.++.++|+|++|.++|+ +++|+|.+|++.++++.+|++++. +
T Consensus 266 ~~~~l~~~l~~~~~~~~----~~~~~~~~~~~~lkGl~V~t~~~---~k~yrI~~i~~~~a~~~~F~~~~~~~~~~~~~~ 338 (900)
T PLN03202 266 QPGPVVDFLIANQNVRD----PFQIDWSKAKRMLKNLRVKVSPS---NQEYKITGLSEKPCKEQTFSLKQRNGNGNEVET 338 (900)
T ss_pred cCCcHHHHHHHhcCcCC----ccchhHHHHHHHhcCCEEEEecC---CceEEEeeccCCCCcceEEEcccCCcccccCCc
Confidence 99999999998765322 11234567999999999999998 478999999999999999987521 3
Q ss_pred ceeeHHHHHHHHcCCccCCC-CCcEEEeccCCCCccccccceEecCCccccccCCHHHHHHHHHhhcCCchHHHHHHHHH
Q 001599 478 TLKSVVEYFYETYGFVIQHT-QWPCLQVGNQQRPNYLPMEVCKIVEGQRYSKRLNERQITALLKVTCQRPHERERDIMQT 556 (1047)
Q Consensus 478 ~~isV~~Yf~~~Y~i~L~~p-~lP~v~~g~~~~~~ylP~Elc~i~~gQ~~~~kl~~~q~~~mik~a~~~P~~R~~~I~~~ 556 (1047)
++|||+|||+++|||+|+|| +||||++|+.++++|||||||.|++||+++++|++.|+++||++|+.+|.+|.+.|.++
T Consensus 339 ~~iSv~dYfk~~Yni~l~~p~~lPlv~~g~~~~~~ylP~ElC~i~~~Q~~~~~l~~~q~~~mik~a~~~P~~R~~~i~~~ 418 (900)
T PLN03202 339 VEITVYDYFVKHRGIELRYSGDLPCINVGKPKRPTYFPIELCSLVSLQRYTKALSTLQRSSLVEKSRQKPQERMKVLTDA 418 (900)
T ss_pred ceEEHHHHHHHHcCccccCCCCCCEEEcCCCCCCeEEcceeeEccCCceechhCCHHHHHHHHHHHccCHHHHHHHHHHH
Confidence 58999999999999999996 99999999988999999999999999999999999999999999999999999999999
Q ss_pred HHhccCCCCccccccCeEEcccceEeeeEEeCCCceeecCCCCccccCCCCcceeccCceeeeCcccceeEEEEecCcch
Q 001599 557 VHHNAYHEDPYAREFGIKISEKLASVEARILPAPWLKYHDTGKEKDCLPQVGQWNMMNKKMVNGGTVNHWICINFSRHVQ 636 (1047)
Q Consensus 557 ~~~~~~~~~~~l~~fGi~i~~~~~~v~grvL~~P~i~y~~~~~~~~~~p~~G~Wnl~~~kf~~~~~l~~W~~v~~~~~~~ 636 (1047)
++.++++.+++|++|||+|+++|++|+|||||+|+|.|+++. .+.|++|+|||++++|++++.+++|+|++|.++.
T Consensus 419 ~~~~~~~~~~~l~~fGi~i~~~~~~V~gRvL~~P~I~y~~~~---~~~p~~g~Wn~~~~kf~~~~~l~~W~vv~~~~~~- 494 (900)
T PLN03202 419 LKSSNYDADPMLRSCGISISSQFTQVEGRVLPAPKLKVGNGE---DFFPRNGRWNFNNKKLVEPTKIERWAVVNFSARC- 494 (900)
T ss_pred HHHhCCCCchHHHHCCcEecCCceEEeEEEcCCceeecCCCc---ccCCCCCceecCCCEecCCCccceEEEEEecCch-
Confidence 988888888999999999999999999999999999998743 2457899999999999999999999999886442
Q ss_pred hHHHHHHHHHHHHHHHhcCcccCCCCcccCCCCC--chhHHHHHHHHHHHHHhhhcCCCCceEEEEEeeCC-CCchhhhh
Q 001599 637 DSIARGFCFELAQMCYISGMAFNPEPVIPPISAR--PEHVEKVLKTRYHDAMTKLGQGKELDLLIVILPDN-NGSLYGDL 713 (1047)
Q Consensus 637 ~~~~~~f~~~l~~~~~~~Gm~i~~~p~~~~~~~~--~~~~~~~l~~~~~~~~~~~~~~~~~~lvlvilp~~-~~~~Y~~I 713 (1047)
.++.|++.|.+.|+.+||.+..++.+.....+ ....+..++..++.+.++++ ..++|||||||++ +.++|+.|
T Consensus 495 --~~~~f~~~l~~~~~~~G~~i~~p~~~~~~~~~~~~~~~~~~~~~~~~~l~~~~~--~~~qlv~vIlp~~~~~~~Y~~I 570 (900)
T PLN03202 495 --DIRHLVRDLIKCGEMKGINIEPPFDVFEENPQFRRAPPPVRVEKMFEQIQSKLP--GPPQFLLCILPERKNSDIYGPW 570 (900)
T ss_pred --hHHHHHHHHHHHHHHCCceeCCCccccccccccccccchHHHHHHHHHHHHhcc--CCCeEEEEEEcCCCCcchHHHH
Confidence 57899999999999999999763322111100 01122335555555444443 4689999999974 67899999
Q ss_pred hHhhhcccCceeEeEeecccccccHHHHHHHHHHHHHhcCccccccccccccCCCCcCCCCeEEEeeeecCCCCCCCCCC
Q 001599 714 KRICETDLGLVSQCCLTKHVFKMSKQYMANVALKINVKVGGRNTVLVDAISRRIPLVSDRPTIIFGADVTHPHPGEDSSP 793 (1047)
Q Consensus 714 K~~~d~~~GI~TQcv~~~~~~k~~~q~~~Nv~lKiN~KlGG~N~~l~~~~~~~~p~~~~~~tmiiG~DVtHp~~g~~~~p 793 (1047)
|++||+++||+||||... +.++||++|||||||+||||+||.+..+....+|++++.+|||||+||+||+++....|
T Consensus 571 K~~~~~~~gV~TQcv~~~---~~~~q~~~NIalKiN~KLGG~n~~~~~~~~~~i~~~~~~~tMivG~DVtHp~~g~~~~p 647 (900)
T PLN03202 571 KKKNLSEFGIVTQCIAPT---RVNDQYLTNVLLKINAKLGGLNSLLAIEHSPSIPLVSKVPTIILGMDVSHGSPGQSDVP 647 (900)
T ss_pred HHHHhhccCcccEEeCcc---ccchHHHHHHHHHHhhhhCCcceeecccccccCccccCCCeEEEEEEeecCCCCCCCCC
Confidence 999999999999999654 35789999999999999999999987654455788888899999999999999875579
Q ss_pred cEEEEEEecCCCCccceEEEEEeecCchhHHHHHH----------------HHhc-CCC--Cc---EEecCCCChhhHHH
Q 001599 794 SIAAVVASQDWPEVTKYAGLVCAQAHRQELIQDLF----------------KTWQ-DPG--TP---YIFPDGVSEGQFYQ 851 (1047)
Q Consensus 794 SiaavVaS~D~~~~~ky~~~~~~Q~~r~EiI~~l~----------------~~~~-~~~--~P---IiyRDGVSEgQf~~ 851 (1047)
||||||||+||+++++|.+.+++|.+++|+|++|+ ..|. +.+ .| ||||||||||||.+
T Consensus 648 Siaa~VaS~d~~~~~~y~s~~~~Q~~~~E~i~~l~~~~~~~~~~~m~~~~L~~~~~~~~~~~P~~IiiyRDGVseGQ~~~ 727 (900)
T PLN03202 648 SIAAVVSSRQWPLISRYRASVRTQSPKVEMIDSLFKPVGDKDDDGIIRELLLDFYTSSGKRKPEQIIIFRDGVSESQFNQ 727 (900)
T ss_pred ceEEEEeccCcccccceeeEEEecCCCceeeeehhccccccchHHHHHHHHHHHHHHcCCCCCceeEEEecCCCHHHHHH
Confidence 99999999998889999999999999999988652 1233 222 35 89999999999999
Q ss_pred HHHHHHHHHHHHHHhhCCCCCCCEEEEEEeecccccccccCCCCCCcCCCCCCCcCceeccCcccCCCcccEEeeeccCC
Q 001599 852 VLLYELDAIRKACASLEPNYQPPVTFVVVQKRHHTRLFANNHHDRNAVDRSGNILPGTVVDSKICHPTEFDFYLCSHAGI 931 (1047)
Q Consensus 852 Vl~~El~~Ik~A~~~l~~~~~P~iT~Ivv~KRHhtRff~~~~~~~~~~~~~~N~~pGTVVD~~It~p~~~DFyL~Sh~~~ 931 (1047)
|+++|+++|++||++++++|+|+||||||+||||||||+.+ +.+||+||||||++||||..||||||||.++
T Consensus 728 Vl~~Ev~~i~~a~~~~~~~~~Pkit~Ivv~Krh~tRff~~~--------~~~N~~pGTvVD~~it~p~~~dFyL~Sh~~~ 799 (900)
T PLN03202 728 VLNIELDQIIEACKFLDESWSPKFTVIVAQKNHHTKFFQAG--------SPDNVPPGTVVDNKICHPRNNDFYMCAHAGM 799 (900)
T ss_pred HHHHHHHHHHHHHHHhCCCCCCcEEEEEEeccceeeeeccC--------CCCCCCCceEeccccccCCcceEEEeccccc
Confidence 99999999999999998899999999999999999999863 3589999999999999999999999999999
Q ss_pred cccccCCeEEEEecCCCCCHHHHHHHHHHhhcccccccCccccCcHHHHHHHHHHHHhhhcCCCCCCCCCCcccCCCCCC
Q 001599 932 QGTSRPAHYHVLWDENKFTADGLQSLTNNLCYTYARCTRSVSIVPPAYYAHLAAFRARFYMEPETSDSGSMTSGTIGRGG 1011 (1047)
Q Consensus 932 qGTsrPthY~VL~De~~~~~d~Lq~LT~~LCy~y~r~t~sVSip~P~yYA~l~a~Rar~~~~~~~~~~~s~~~~~~~~~~ 1011 (1047)
|||||||||+||+||+++++|+||+|||+|||+|+|||++||||||||||||||+|||+||..+.++++++.+++++
T Consensus 800 qGTarPthY~Vl~de~~~~~d~lq~lty~lc~~y~~~t~~VsvpaP~yYAhlla~r~r~~l~~~~~~~~~~~~~~~~--- 876 (900)
T PLN03202 800 IGTTRPTHYHVLLDEIGFSADDLQELVHSLSYVYQRSTTAISVVAPVCYAHLAAAQMGQFMKFEDMSETSSSHGGIT--- 876 (900)
T ss_pred ccCCcCceEEEEECCCCCCHHHHHHHHHHHhhhhcccCCceecchhHHHHHHHHHHhhhhccccCCccccccccccC---
Confidence 99999999999999999999999999999999999999999999999999999999999998543222221111110
Q ss_pred CCCCCCCccCCCCCCCCCCCCCcccccccccCeeeC
Q 001599 1012 MGGGVGARSTRGPGVGAAVRPLPALKENVKRVMFYC 1047 (1047)
Q Consensus 1012 ~~~~~~~~~~~~~~~~~~~~~~~~vh~~~~~~M~y~ 1047 (1047)
+ + ...+...+++||+||+++||||
T Consensus 877 ------~--~----~~~~~~~~~~~h~~~~~~Mfy~ 900 (900)
T PLN03202 877 ------S--A----GAVPVPELPRLHENVASSMFFC 900 (900)
T ss_pred ------C--C----CccccccccccchhhcCCeeeC
Confidence 0 0 1111335788999999999998
No 2
>KOG1041 consensus Translation initiation factor 2C (eIF-2C) and related proteins [Translation, ribosomal structure and biogenesis]
Probab=100.00 E-value=1.9e-150 Score=1391.14 Aligned_cols=813 Identities=39% Similarity=0.611 Sum_probs=687.6
Q ss_pred ccCCCCCCCCCCCCcceEEeeeEEeecC--CCc-eeeeEEEEcCCcccchhhH-HHHHHHHHHHHhhccCCccceeeccc
Q 001599 199 VRFPLRPGRGSTGTRCIVKANHFFAELP--DKD-LHQYDVTITPEVTSRGVNR-AVMEQLVKLYRESHLGKRLPAYDGRK 274 (1047)
Q Consensus 199 ~~~p~RP~~Gt~G~~v~l~aN~f~v~~~--~~~-iy~YdV~i~pe~~~k~~~r-~i~~~l~~~~~~~~~~~~~~~yDG~~ 274 (1047)
...+.||+.|+.|++|.|.||||.+++. +.. ++||+|++.++...+.+++ .++..+++......+....++|||++
T Consensus 43 ~~~~~rp~~~~~g~~i~~~~n~f~~~~~~~~~~~~~~y~v~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~YDg~~ 122 (876)
T KOG1041|consen 43 RFPMNRPGGGTKGKKIMVLVNHFKVDLKFTEESLFVHYSVGIFNEHGRRKVQCLRFFLDKVKNPELFELKSGGPAYDGQK 122 (876)
T ss_pred cccccCCCCCccceEEEEeeeEEEeccccCCcceEEEeeeeecCCCCchHHHHHHHHHHHHhccccccccCCcccccCCc
Confidence 4456799999999999999999997764 554 9999999999988777764 56655555433333555566799999
Q ss_pred eEEecCCCCCCCceEEEEEecCCCCCCCCCCcEEEEEEEEeeeeChhhHHHHhccCCCCChHHHHHHHHHHHhcCCCCC-
Q 001599 275 SLYTAGPLPFLSKEFRITLLDDDDGQGGQREREFKVVIKLAARADLHHLGLFLQGRQADAPQEALQVLDIVLRELPTTR- 353 (1047)
Q Consensus 275 ~lys~~~Lp~~~~~~~v~~~~~~~~~~~~~~~~~~V~i~~~~~i~l~~l~~~l~~~~~~~~~~~lq~Lniilr~~~~~~- 353 (1047)
+|||..+|+.....+++.+..+.+ ... |+++|++++.+.+..+..++.+.....+.+++|+||+++++.++.+
T Consensus 123 ~lyt~~~~~~~~~~~~~~~~~~~~-----~~~-~~~~ik~~~~~~~~~~~~~~~~~~~~~~~~~~~~ld~~~~~~~s~~~ 196 (876)
T KOG1041|consen 123 TLYTKLELPEGVVTLDFDVISPKE-----WKK-FKVSIKKVSEVVLTKLNGFIYTRGENAPRDANQTLDVVLREIATSQG 196 (876)
T ss_pred eeEeccccccccceEEEEecCCCC-----Ccc-eEEEEEecccccccCccccccCccccCchhHHHHHHHHHHhhhchhc
Confidence 999977777423333333322211 122 9999999999999999999998888889999999999999999887
Q ss_pred cccccccccCCCCCCcccCCCCeEEeecceeeeeccCCeeeeeeecccceeecCccHHHHHHHHhcCCCCCCCCChHHHH
Q 001599 354 YCPVGRSFYSPDLGRRQPLGEGLESWRGFYQSIRPTQMGLSLNIDMSSTAFIEPLPVIDFVQQLLNRDVSSRPLSDADRV 433 (1047)
Q Consensus 354 ~~~~Gr~ff~~~~~~~~~l~~Gle~~~G~~~Svr~~~~~l~LniD~s~~~F~~~~~l~d~~~~~~~~~~~~~~~~~~~~~ 433 (1047)
+..++++||.........+++|.|+|.||++|+|+++++++||+|+++++||++.+|+++++++++... +.+......
T Consensus 197 ~~~~~~sff~~~~~~~~~l~~g~e~~~Gf~~s~r~~~~~~~l~id~~~~~F~k~~~~~~~l~~~~~~~~--~~~~~~~~~ 274 (876)
T KOG1041|consen 197 LNNVGYSFFGNDTREPAKLGGGVEIWEGFHKSIRPTQGGLSLNIDVKTTAFYKGTPVIEFLKKILEIKT--RAFHKDRPL 274 (876)
T ss_pred ccccchheecCCCCCccccCCCceeeeeeeeeeeeccCceEEeeeeeeeeeecCcchHHHHHhhhcCcc--cccccccch
Confidence 999999999863333445899999999999999999999999999999999999999999999987543 223222223
Q ss_pred HHHHHccceEEEEeecCCcCceEEEeccCCCCCcceeeeecCC-CceeeHHHHHHHHcCCccCCCCCcEEEeccCCCCcc
Q 001599 434 KIKKALRGVRVEVTHRGNMRRKYRISGLTSQTTGELTFPVDES-GTLKSVVEYFYETYGFVIQHTQWPCLQVGNQQRPNY 512 (1047)
Q Consensus 434 ~l~~~L~gl~V~~~~~~~~~r~~~I~~i~~~~a~~~~F~~~~~-g~~isV~~Yf~~~Y~i~L~~p~lP~v~~g~~~~~~y 512 (1047)
.++++|+||+|+++| ++..|.|+|.+++..++++++|++++. +.++||+|||+++||++|+||+||||+++..++.+|
T Consensus 275 ~~~~~lkgL~v~~~h-~~~~r~~~i~~l~~~~a~~~~F~l~~~~~~~~tV~~Yf~~ky~~~Lkyp~LPcv~v~~~~~~~~ 353 (876)
T KOG1041|consen 275 DIKKALKGLKVYVTH-GKRKRKIKIMGLSKKPAKNTTFELKDKKGREITVADYFLEKYNITLKYPDLPCVVVKRPKRENF 353 (876)
T ss_pred hHHHHhhCcEEEEec-ccCcceEEEecccCCcccCceeeccCCCceEEeHHHHHHHhcCccccCCCCccEeecCCCCCcc
Confidence 499999999999999 566899999999999999999998654 588999999999999999999999999999999999
Q ss_pred ccccceEecCCccccc-cCCHHHHHHHHHhhcCCchHHHHHHHHHHHhccCCCCccccccCeEEcccceEeeeEEeCCCc
Q 001599 513 LPMEVCKIVEGQRYSK-RLNERQITALLKVTCQRPHERERDIMQTVHHNAYHEDPYAREFGIKISEKLASVEARILPAPW 591 (1047)
Q Consensus 513 lP~Elc~i~~gQ~~~~-kl~~~q~~~mik~a~~~P~~R~~~I~~~~~~~~~~~~~~l~~fGi~i~~~~~~v~grvL~~P~ 591 (1047)
+|||+|.|++||++.+ +|++.|+++|++.+++.|++|.+.|.++++...+..|++|++|||+|.++|+.|+|||||||.
T Consensus 354 ~PmElc~i~~gQr~~k~kl~~~q~~~m~k~~~~~P~~R~~~i~~~~~~~~~~~d~~l~~fGi~i~~~~~~v~grvL~~P~ 433 (876)
T KOG1041|consen 354 YPMELCNIVPGQRITKEKLTPNQQSAMIKASAVKPDQRQKLIKKVLKSSLKLSNPYLKEFGIIVVSEPTQVEGRVLPPPK 433 (876)
T ss_pred cchhheecccCceeecccCCHHHHHHhhhhhcCCHHHHHHHHHHHHHHhccccchhHHhcCeEEecccccccccccCCce
Confidence 9999999999999998 999999999999999999999999999999888888999999999999999999999999999
Q ss_pred eeecCCCCccccCCCCcceeccCceeeeCcccceeEEEEecCcchhHHHHHHHHHHHHHHHhcCcccCCCCcccCCCCCc
Q 001599 592 LKYHDTGKEKDCLPQVGQWNMMNKKMVNGGTVNHWICINFSRHVQDSIARGFCFELAQMCYISGMAFNPEPVIPPISARP 671 (1047)
Q Consensus 592 i~y~~~~~~~~~~p~~G~Wnl~~~kf~~~~~l~~W~~v~~~~~~~~~~~~~f~~~l~~~~~~~Gm~i~~~p~~~~~~~~~ 671 (1047)
|+|+++ .....|..|.|++++++|++|+.+..|+|++|....+... +.|+++|++.|+..||.|.. |. ......
T Consensus 434 L~~~~~--~~~~~p~~g~~~~~~k~~~~~~~i~~wavv~f~~~~~~~~-~~f~~~L~~~c~~~Gm~i~~-~~--~~~~~~ 507 (876)
T KOG1041|consen 434 LKFGGN--EMPKNPTPGTWFMRNKKFVKPAKIKSWAVVNFSNSETLRQ-KQFVDELIKICKDKGMEIKR-PR--KWAPTE 507 (876)
T ss_pred eeccCC--CCccCCCcCccccccCcccccceEEEEEEEEecccccccH-HHHHHHHHHHHHHcCccccc-cc--ccCccc
Confidence 999975 3345688999999999999999999999999976554444 89999999999999999976 55 222222
Q ss_pred hhHHHHHHHHHHHHHhhhcCCCCceEEEEEeeCCCCchhhhhhHhhhcccCceeEeEeecccccccHHHHHHHHHHHHHh
Q 001599 672 EHVEKVLKTRYHDAMTKLGQGKELDLLIVILPDNNGSLYGDLKRICETDLGLVSQCCLTKHVFKMSKQYMANVALKINVK 751 (1047)
Q Consensus 672 ~~~~~~l~~~~~~~~~~~~~~~~~~lvlvilp~~~~~~Y~~IK~~~d~~~GI~TQcv~~~~~~k~~~q~~~Nv~lKiN~K 751 (1047)
.+++..++ ......+....++||+||+++++.++|+.||++||+.+||+||||+.+++.|..+||++||+||||+|
T Consensus 508 ~~~~~~~~----~~~~~~~~~~~~~li~~I~~~k~~~vy~~lK~~e~t~~gi~tQc~~~~~~~k~~~qtl~Nl~lKiN~K 583 (876)
T KOG1041|consen 508 ESLEDMIT----EKSSMEKAAAGVQLVFIILPEKNPDVHDELKYIEETVGGLTTQCIRPTTAKKMSPQTLANLILKINVK 583 (876)
T ss_pred chhHHHHH----HHHhhhccCCCceEEEEEECCCCcchhHHHHHHHHHhcCceeEEeecchhcccchHHHHHHHHHHhhc
Confidence 33443333 22222211256999999999999999999999999999999999999999999999999999999999
Q ss_pred cCccccccccccccCCCCcCCCCeEEEeeeecCCCCCCCC--CCcEEEEEEecCCCCccceEEEEEeecCchhHHHHHHH
Q 001599 752 VGGRNTVLVDAISRRIPLVSDRPTIIFGADVTHPHPGEDS--SPSIAAVVASQDWPEVTKYAGLVCAQAHRQELIQDLFK 829 (1047)
Q Consensus 752 lGG~N~~l~~~~~~~~p~~~~~~tmiiG~DVtHp~~g~~~--~pSiaavVaS~D~~~~~ky~~~~~~Q~~r~EiI~~l~~ 829 (1047)
|||+|+.|..+.....| +.+.||||||+|||||+++... .|||||||+|+|| +.++|.+.+++|.+|+|+|+++.+
T Consensus 584 lGG~N~~l~~~~~~~~~-~~~~ptl~IG~dVsHp~~~~~~~~~PSiagvv~s~~~-~~~~y~g~~~~Q~~r~e~i~~~~~ 661 (876)
T KOG1041|consen 584 LGGLNYVLVSPRSSRGP-KLDSPTLFIGFDVSHPAAGTSFDGNPSIVGVVYNLDW-HPQKFAGFVRFQKSRQEVIQDLGE 661 (876)
T ss_pred cCceeeEEecccccCcc-cCCCCeEEEEEeeeCCCcCCCcCCCccEEEEEecccc-cchhhcceEEEecCChhhhcchHH
Confidence 99999988876433344 4578999999999999998755 5999999999997 999999999999999999988544
Q ss_pred H-------hcCC--CCc---EEecCCCChhhHHHHHHHHHHHHHHHHHhhCCCCCCCEEEEEEeecccccccccCCCCCC
Q 001599 830 T-------WQDP--GTP---YIFPDGVSEGQFYQVLLYELDAIRKACASLEPNYQPPVTFVVVQKRHHTRLFANNHHDRN 897 (1047)
Q Consensus 830 ~-------~~~~--~~P---IiyRDGVSEgQf~~Vl~~El~~Ik~A~~~l~~~~~P~iT~Ivv~KRHhtRff~~~~~~~~ 897 (1047)
+ |.+. .+| ||||||||||||.+|+++|+.+||+||..+.++|+|+||||||+||||||||+.+..+ +
T Consensus 662 ~~~~~l~~f~~~t~~~P~~IIiyRdGvSEgqf~~vl~~E~~~ir~a~~~~~~~y~P~it~Iv~qKrHhtR~F~~~~~~-~ 740 (876)
T KOG1041|consen 662 MIRELLRSFRKSTRKLPDRIVIYRDGVSEGQFSMVLEEELRAIKEACKKLQEGYNPKITVIVAQKRHHTRLFAAELSK-D 740 (876)
T ss_pred HHHHHHHHHHHhccCCCceEEEEecCCccchHHHHHHHHHHHHHHHHHHhCCCCCCceEEEEEEcccceeeecccCCC-C
Confidence 4 3332 235 9999999999999999999999999999999999999999999999999999998862 1
Q ss_pred cCCCCCCCcCceeccCcccCCCcccEEeeeccCCcccccCCeEEEEecCCCCCHHHHHHHHHHhhcccccccCccccCcH
Q 001599 898 AVDRSGNILPGTVVDSKICHPTEFDFYLCSHAGIQGTSRPAHYHVLWDENKFTADGLQSLTNNLCYTYARCTRSVSIVPP 977 (1047)
Q Consensus 898 ~~~~~~N~~pGTVVD~~It~p~~~DFyL~Sh~~~qGTsrPthY~VL~De~~~~~d~Lq~LT~~LCy~y~r~t~sVSip~P 977 (1047)
..++.+||+||||||+.||||.+||||||||.++|||||||||||||||++|++|+||+|||+|||+|+|||+|||||+|
T Consensus 741 ~~~~~~Nv~pGT~VD~~It~p~~~dFyL~sh~g~qGTsrp~~Y~VL~dd~~~~~d~lq~lt~~Lc~~~qr~t~pvSiP~P 820 (876)
T KOG1041|consen 741 GKAQSQNVPPGTVVDTTITSPGYFDFYLCSHHGLQGTSKPTHYTVLYDDIGFSKDELQKLTYALCFTHQRCTKPVSLPAP 820 (876)
T ss_pred ccCCccCCCCCCEecccccCCCcceEEEeccCcccccccCceEEEEeCCCCCCHHHHHHHHHHHhhheeeecCCCcCCch
Confidence 25678999999999999999999999999999999999999999999999999999999999999999999999999999
Q ss_pred HHHHHHHHHHHhhhcCCCCCCCCCCcccCCCCCCCCCCCCCccCCCCCCCCCCCCCcccccccccCeeeC
Q 001599 978 AYYAHLAAFRARFYMEPETSDSGSMTSGTIGRGGMGGGVGARSTRGPGVGAAVRPLPALKENVKRVMFYC 1047 (1047)
Q Consensus 978 ~yYA~l~a~Rar~~~~~~~~~~~s~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~vh~~~~~~M~y~ 1047 (1047)
+||||++|+|||.|.+....+.+...++.+.. ......+..++++|.++.++||||
T Consensus 821 ~YyA~~~A~Rgr~~~~~~~~~~~~~~~~~s~~--------------~~~~~~~~~~~~~~~~~~~~~f~a 876 (876)
T KOG1041|consen 821 LYYAHEVAKRGRNNYKEHLREKNSSAIYQSIV--------------DLDALNSEEGYKEKAGLFGTRFNA 876 (876)
T ss_pred HHHHHHHHHHhhhhhhhhccccCCCccccccc--------------ccchhhhhhHHHhhhcccceEEeC
Confidence 99999999999999433222222211111100 011222455789999999999998
No 3
>KOG1042 consensus Germ-line stem cell division protein Hiwi/Piwi; negative developmental regulator [Cell cycle control, cell division, chromosome partitioning]
Probab=100.00 E-value=2.8e-116 Score=983.56 Aligned_cols=713 Identities=26% Similarity=0.420 Sum_probs=606.8
Q ss_pred CCCCCCCcceEEeeeEEeecC-CCceeeeEEEEcCCcccchhhHHHHHHHHHHHHhhccCCccceeeccceEEecCCCCC
Q 001599 206 GRGSTGTRCIVKANHFFAELP-DKDLHQYDVTITPEVTSRGVNRAVMEQLVKLYRESHLGKRLPAYDGRKSLYTAGPLPF 284 (1047)
Q Consensus 206 ~~Gt~G~~v~l~aN~f~v~~~-~~~iy~YdV~i~pe~~~k~~~r~i~~~l~~~~~~~~~~~~~~~yDG~~~lys~~~Lp~ 284 (1047)
..|+.|.+|+|.||||++... ++.||||+|+++|++++++++++++. .+.+ .+|. ..+|||. .||..++|..
T Consensus 87 KtGssG~pv~l~tN~f~l~t~p~w~iyqYhVef~P~ves~rlR~~~L~----~h~~-lig~-~~~FDG~-iLfl~~k~eq 159 (845)
T KOG1042|consen 87 KTGSSGIPVKLQTNFFRLMTRPDWSIYQYHVEFEPDVESRRLREALLY----NHTD-LIGK-GYAFDGT-ILFLKEKFEQ 159 (845)
T ss_pred ccCCCCceEEEEeceeeeccCCCcEEEEEEEeeccccccHHHHHHHHH----HhHh-hhcc-ceeecce-eehhhHHHhh
Confidence 458999999999999998764 89999999999999998887666554 3333 2443 4589997 7999988853
Q ss_pred CCceEEEEEecCCCCCCCCCCcEEEEEEEEeeeeChhhHHHHhccCCCCChHHHHHHHHHHHhcC-CCCCcccccccccC
Q 001599 285 LSKEFRITLLDDDDGQGGQREREFKVVIKLAARADLHHLGLFLQGRQADAPQEALQVLDIVLREL-PTTRYCPVGRSFYS 363 (1047)
Q Consensus 285 ~~~~~~v~~~~~~~~~~~~~~~~~~V~i~~~~~i~l~~l~~~l~~~~~~~~~~~lq~Lniilr~~-~~~~~~~~Gr~ff~ 363 (1047)
+..+ .+ . .+.....++++||+++++.. .+.+.||++|+|+|.. ..+++..+||+||+
T Consensus 160 ~~te---l~-~-----ks~~ge~i~I~ik~~~~~~~-------------t~p~~iqv~NlI~RR~~k~L~L~qigRnyyn 217 (845)
T KOG1042|consen 160 KQTE---LV-S-----KSRDGELIKITIKLTNELPS-------------TDPQCIQVFNLILRRSMKGLNLTQIGRNYYD 217 (845)
T ss_pred hhhe---ee-c-----ccCCCceEEEEEEEeccccC-------------CChhHHHHHHHHHHHHHhhccHHHhhhccCC
Confidence 2211 11 1 11356789999999988643 3567999999999984 46789999999999
Q ss_pred CCCCCcccC-CCCeEEeecceeeeeccCCeeeeeeecccceeecCccHHHHHHHHhcCCCCCCCCChHHHHHHHHHccce
Q 001599 364 PDLGRRQPL-GEGLESWRGFYQSIRPTQMGLSLNIDMSSTAFIEPLPVIDFVQQLLNRDVSSRPLSDADRVKIKKALRGV 442 (1047)
Q Consensus 364 ~~~~~~~~l-~~Gle~~~G~~~Svr~~~~~l~LniD~s~~~F~~~~~l~d~~~~~~~~~~~~~~~~~~~~~~l~~~L~gl 442 (1047)
+. ...++ ..-+++|+||-.|||..+..++|+.|++|+ ..+..+|.|+|..+... ++...+++++.+-|+
T Consensus 218 p~--~~i~ip~~km~lwPGy~tSIrq~E~~illctei~hK-vmR~ETvy~~m~~~~~~-------~~~~qe~~~~~~~gl 287 (845)
T KOG1042|consen 218 PR--AKIEIPEFKMSLWPGYETSIRQHENDILLCTEISHK-VMRTETVYDIMRSCQHN-------TQRFQETVNKNVIGL 287 (845)
T ss_pred CC--cccccccccceecCcchhHHHHhhhceeeehhhhhh-HhhhhHHHHHHHHHhhC-------HHHHHHHHHHHhcce
Confidence 86 34555 457999999999999999999999999998 57888999999988652 344667899999999
Q ss_pred EEEEeecCCcCceEEEeccCCCCCcceeeeecCCCceeeHHHHHHHHcCCccCCCCCcEEEeccCC--------CCcccc
Q 001599 443 RVEVTHRGNMRRKYRISGLTSQTTGELTFPVDESGTLKSVVEYFYETYGFVIQHTQWPCLQVGNQQ--------RPNYLP 514 (1047)
Q Consensus 443 ~V~~~~~~~~~r~~~I~~i~~~~a~~~~F~~~~~g~~isV~~Yf~~~Y~i~L~~p~lP~v~~g~~~--------~~~ylP 514 (1047)
.|.|.|+ +|+|+|.+|++..++..+|..+ +.+||+.|||+++|||+|++-+||+|....++ ..+++.
T Consensus 288 ivLT~YN---NktyriddvD~~~tP~stF~k~--dgeIs~veYyk~qYni~I~dl~QPlliS~~k~K~~~g~~~q~~~lI 362 (845)
T KOG1042|consen 288 IVLTRYN---NKTYRIDDVDFSQTPLSTFKKD--DGEISFVEYYKKQYNIEITDLNQPLLISEPKDKRPKGEPPQLAMLI 362 (845)
T ss_pred EEEEecC---CceeeeeccccCcCccceeeec--CceeeHhHHHHHhcCeEEeeCCcceEeccCcccCCCCCCccceeee
Confidence 9999998 7999999999999999999864 34999999999999999999999999985432 247999
Q ss_pred ccceEecCCccccccCCHHHHHHHHHhhcCCchHHHHHHHHHHHhccCCCC--ccccccCeEEcccceEeeeEEeCCCce
Q 001599 515 MEVCKIVEGQRYSKRLNERQITALLKVTCQRPHERERDIMQTVHHNAYHED--PYAREFGIKISEKLASVEARILPAPWL 592 (1047)
Q Consensus 515 ~Elc~i~~gQ~~~~kl~~~q~~~mik~a~~~P~~R~~~I~~~~~~~~~~~~--~~l~~fGi~i~~~~~~v~grvL~~P~i 592 (1047)
||||.++ |-...++-+.+.+++|.+++...|.+|...+..+...+.-+.+ +.|+.|||+++.++++|+|||||+.+|
T Consensus 363 PELc~~T-GLtd~mr~dF~~Mkama~hTRlsP~qR~~rlr~li~~l~~n~~~~~~lr~Wgi~ld~~l~~v~gRil~sEkI 441 (845)
T KOG1042|consen 363 PELCFLT-GLTDEMRSDFQLMKAMAEHTRLSPQQRQDRLRRLIDRLQKNPNSVEELRDWGISLDSNLAEVQGRILPSEKI 441 (845)
T ss_pred hhhhhcc-CCcHHHHhhHHHHHHHHHHhcCCHHHHHHHHHHHHHHHhcChHHHHHHHhcCcccCcchhhccceecCccce
Confidence 9999998 6666677788889999999999999999999888776643332 468999999999999999999999999
Q ss_pred eecCCCCccccCCCCccee--ccCceeeeCcccceeEEEEecCcchhHHHHHHHHHHHHHHHhcCcccCCCCcccCCCCC
Q 001599 593 KYHDTGKEKDCLPQVGQWN--MMNKKMVNGGTVNHWICINFSRHVQDSIARGFCFELAQMCYISGMAFNPEPVIPPISAR 670 (1047)
Q Consensus 593 ~y~~~~~~~~~~p~~G~Wn--l~~~kf~~~~~l~~W~~v~~~~~~~~~~~~~f~~~l~~~~~~~Gm~i~~~p~~~~~~~~ 670 (1047)
.+++.. ....+....|. ++.-++++...+++|++++..+. ..+++.|++.|.+.+..+||+|.++-.+.+...+
T Consensus 442 ~~~~~~--~~~~~~~ADWsr~~R~c~i~~~~~l~~W~vi~p~r~--~~~a~~fi~~l~r~a~~mgm~i~~P~~v~i~ddr 517 (845)
T KOG1042|consen 442 LFGNQK--VPYEGKQADWSREFRTCGILRGSNLDNWAVIYPGRN--NSEAQEFINMLRRVASSMGMQIREPICVEIKDDR 517 (845)
T ss_pred ecCCcc--cCCCcchhhhhhhcccccccccCCCcceEEEecCcc--HHHHHHHHHHHHHhccccceecCCceEEEeCCCC
Confidence 998742 12334457896 57778899999999999976553 4578999999999999999999875556666666
Q ss_pred chhHHHHHHHHHHHHHhhhcCCCCceEEEEEeeCCCCchhhhhhHhhhcccCceeEeEeeccccccc--HHHHHHHHHHH
Q 001599 671 PEHVEKVLKTRYHDAMTKLGQGKELDLLIVILPDNNGSLYGDLKRICETDLGLVSQCCLTKHVFKMS--KQYMANVALKI 748 (1047)
Q Consensus 671 ~~~~~~~l~~~~~~~~~~~~~~~~~~lvlvilp~~~~~~Y~~IK~~~d~~~GI~TQcv~~~~~~k~~--~q~~~Nv~lKi 748 (1047)
++.+-++|++.. +..+|||+||||+.+.+.|+.||++++++..||||||..+|+.+.. ..+...|||+|
T Consensus 518 ~~tYvraiqq~v---------~~D~qmvvcil~~~nk~~Y~sIKK~~cvd~pvPsQ~V~lrTl~~~~~lmSIAtKI~lQm 588 (845)
T KOG1042|consen 518 PGTYVRAIQQVV---------GADIQMVVCILPSDNKTRYDSIKKYLCVDCPVPSQCVNLRTLAKRSKLMSIATKIALQM 588 (845)
T ss_pred hHHHHHHHHHhc---------cCCceEEEEEecCCchhhHHHHHhheeccCCCccceEEEEeecCcchhHHHHHHHHHHH
Confidence 788877776654 3579999999999999999999999999999999999999997643 46778999999
Q ss_pred HHhcCccccccccccccCCCCcCCCCeEEEeeeecCCCCCCCCCCcEEEEEEecCCCCccceEEEEEeecCchhHHHHHH
Q 001599 749 NVKVGGRNTVLVDAISRRIPLVSDRPTIIFGADVTHPHPGEDSSPSIAAVVASQDWPEVTKYAGLVCAQAHRQELIQDLF 828 (1047)
Q Consensus 749 N~KlGG~N~~l~~~~~~~~p~~~~~~tmiiG~DVtHp~~g~~~~pSiaavVaS~D~~~~~ky~~~~~~Q~~r~EiI~~l~ 828 (1047)
|+||||..|.++ ||+ +.+||||+||+|.+.. ..-|++|+||||| ..+++|.+.+..|...+|+.+.|.
T Consensus 589 nCKlGg~lW~V~------IPL---k~lMiVG~Dv~hd~~~--k~rsvga~VAs~n-~~~tr~fS~v~~~~~~qel~d~L~ 656 (845)
T KOG1042|consen 589 NCKLGGELWKVE------IPL---KGLMIVGFDVYHDPTL--KGRSVGAFVASMN-NDFTRWFSRVIEQENGQELADNLK 656 (845)
T ss_pred hhhhcCcceEEe------eec---ccceEEEEEeecCccc--cCceEEEEEEeec-cchhhhhhheecccCHHHHHHHHH
Confidence 999999999886 565 5699999999998642 3569999999999 999999999999999999987753
Q ss_pred -------HHhcCCCC--c---EEecCCCChhhHHHHHHHHHH----HHHHHHHhhCCCCCCCEEEEEEeecccccccccC
Q 001599 829 -------KTWQDPGT--P---YIFPDGVSEGQFYQVLLYELD----AIRKACASLEPNYQPPVTFVVVQKRHHTRLFANN 892 (1047)
Q Consensus 829 -------~~~~~~~~--P---IiyRDGVSEgQf~~Vl~~El~----~Ik~A~~~l~~~~~P~iT~Ivv~KRHhtRff~~~ 892 (1047)
+.|.+.++ | ||||||||+||+.+|.++|++ ++.+.++++..+++|+++||||+||.+||||...
T Consensus 657 ~~~~~ALr~y~~~n~~LPsRIi~YRDGVgDGQLk~l~n~EV~~~~dql~~~~a~~~~~~~~rl~~iVV~KrvntR~f~~~ 736 (845)
T KOG1042|consen 657 VFLAKALRQYYEVNRTLPSRIIVYRDGVGDGQLKTLVNYEVPLVCDQLLDCYAELSNKEKPRLAVIVVTKRVNTRFFLQG 736 (845)
T ss_pred HHHHHHHHHHHHhcccCCceEEEEecCCCCcccceeeeeccchHHHHHHHHHHHhcCCCCCcEEEEEEEeeccHHHHhhC
Confidence 34655333 4 999999999999999999999 7777778887789999999999999999999976
Q ss_pred CCCCCcCCCCCCCcCceeccCcccCCCcccEEeeeccCCcccccCCeEEEEecCCCCCHHHHHHHHHHhhcccccccCcc
Q 001599 893 HHDRNAVDRSGNILPGTVVDSKICHPTEFDFYLCSHAGIQGTSRPAHYHVLWDENKFTADGLQSLTNNLCYTYARCTRSV 972 (1047)
Q Consensus 893 ~~~~~~~~~~~N~~pGTVVD~~It~p~~~DFyL~Sh~~~qGTsrPthY~VL~De~~~~~d~Lq~LT~~LCy~y~r~t~sV 972 (1047)
.. +..||+||||||+.||.|..+||||+||++.|||..||||.||||++++++|.+|+|||+|||+|++|.+.|
T Consensus 737 ~~------~~~NP~PGTVVD~~iT~pEryDFyLvsQ~VrqGtvsPTsYnvi~d~~gL~PDkmQrLtfKlCHlYyNW~Gti 810 (845)
T KOG1042|consen 737 SS------NAQNPPPGTVVDDTITRPERYDFYLVSQAVRQGTVSPTSYNVIYDDMGLSPDKMQRLTFKLCHLYYNWPGTI 810 (845)
T ss_pred Cc------cccCCCCCceecceecccceeeeEeehhhhhcCCcCCceEEEEecCCCCCHHHHHHHHHHHhheeecCCcce
Confidence 43 578999999999999999999999999999999999999999999999999999999999999999999999
Q ss_pred ccCcHHHHHHHHHHHHhhhcCC
Q 001599 973 SIVPPAYYAHLAAFRARFYMEP 994 (1047)
Q Consensus 973 Sip~P~yYA~l~a~Rar~~~~~ 994 (1047)
++||||.|||++|+..-.-++.
T Consensus 811 RVPApCqYAHKLAfLv~qslH~ 832 (845)
T KOG1042|consen 811 RVPAPCQYAHKLAFLVAQSLHR 832 (845)
T ss_pred eccchhHHHHHHHHHHHhhhhh
Confidence 9999999999999988776654
No 4
>cd04657 Piwi_ago-like Piwi_ago-like: PIWI domain, Argonaute-like subfamily. Argonaute is the central component of the RNA-induced silencing complex (RISC) and related complexes. The PIWI domain is the C-terminal portion of Argonaute and consists of two subdomains, one of which provides the 5' anchoring of the guide RNA and the other, the catalytic site for slicing.
Probab=100.00 E-value=1.1e-99 Score=887.00 Aligned_cols=408 Identities=52% Similarity=0.885 Sum_probs=356.3
Q ss_pred ccccccCeEEcccceEeeeEEeCCCceeecCCCCccccCCCCcceeccCceeeeCcccceeEEEEecCcchh----HHHH
Q 001599 566 PYAREFGIKISEKLASVEARILPAPWLKYHDTGKEKDCLPQVGQWNMMNKKMVNGGTVNHWICINFSRHVQD----SIAR 641 (1047)
Q Consensus 566 ~~l~~fGi~i~~~~~~v~grvL~~P~i~y~~~~~~~~~~p~~G~Wnl~~~kf~~~~~l~~W~~v~~~~~~~~----~~~~ 641 (1047)
++|++|||+|+++|++|+||+|+||+|.|+++.+ ...+.+|+||+++++|++++.+++|+||++.+..+. +.++
T Consensus 1 ~~l~~fGi~i~~~~~~v~grvL~~P~i~y~~~~~--~~~~~~g~W~~~~~~f~~~~~~~~W~vi~~~~~~~~~~~~~~~~ 78 (426)
T cd04657 1 PYLKEFGISVSKEMITVPGRVLPPPKLKYGDSSK--TVPPRNGSWNLRGKKFLEGGPIRSWAVLNFAGPRRSREERADLR 78 (426)
T ss_pred ChhHhCCCEecCCeeEEeEEEcCCceeeccCCcc--ccCCCCCceeecCcccCCCcccceEEEEEecCccccchhHHHHH
Confidence 4689999999999999999999999999996332 345779999999999999999999999988643221 4789
Q ss_pred HHHHHHHHHHHhcCcccCCCCcccCCCCCchhHHHHHHHHHHHHHhhhcCCCCceEEEEEeeCCCCchhhhhhHhhhccc
Q 001599 642 GFCFELAQMCYISGMAFNPEPVIPPISARPEHVEKVLKTRYHDAMTKLGQGKELDLLIVILPDNNGSLYGDLKRICETDL 721 (1047)
Q Consensus 642 ~f~~~l~~~~~~~Gm~i~~~p~~~~~~~~~~~~~~~l~~~~~~~~~~~~~~~~~~lvlvilp~~~~~~Y~~IK~~~d~~~ 721 (1047)
.|++.|.+.|+.+||.+. .... ...+ .++.+++.+.++. ...++|||||||+++.++|+.||++||+++
T Consensus 79 ~F~~~l~~~~~~~g~~~~--~~~~---~~~~----~~~~~~~~~~~~~--~~~~~lv~~ilp~~~~~~Y~~iK~~~~~~~ 147 (426)
T cd04657 79 NFVDQLVKTVIGAGINIT--TAIA---SVEG----RVEELFAKLKQAK--GEGPQLVLVILPKKDSDIYGRIKRLADTEL 147 (426)
T ss_pred HHHHHHHHHHHhcCCccc--cccc---ccch----hHHHHHHHHHhhc--cCCCCEEEEEEcCCCcchHHHHHHHHhhcC
Confidence 999999999999999986 1111 1122 2334444333322 136999999999988889999999999999
Q ss_pred CceeEeEeeccccc-ccHHHHHHHHHHHHHhcCccccccccccccCCCCcCCCCeEEEeeeecCCCCCC-CCCCcEEEEE
Q 001599 722 GLVSQCCLTKHVFK-MSKQYMANVALKINVKVGGRNTVLVDAISRRIPLVSDRPTIIFGADVTHPHPGE-DSSPSIAAVV 799 (1047)
Q Consensus 722 GI~TQcv~~~~~~k-~~~q~~~Nv~lKiN~KlGG~N~~l~~~~~~~~p~~~~~~tmiiG~DVtHp~~g~-~~~pSiaavV 799 (1047)
||+||||..+++.| .++||+.||+||||+||||+||.|++.. .+++...+|||||+||+||++++ ...|||||||
T Consensus 148 gI~TQci~~~~~~k~~~~~~~~NI~lKin~KlGG~n~~v~~~~---~~~~~~~~tmiiG~Dv~H~~~~~~~~~pSiaa~V 224 (426)
T cd04657 148 GIHTQCVLAKKVTKKGNPQYFANVALKINLKLGGINHSLEPDI---RPLLTKEPTMVLGADVTHPSPGDPAGAPSIAAVV 224 (426)
T ss_pred CcccEEEcccccccccchHHHHHHHHHHHHhcCCEeeeccccc---ccccCCCCEEEEEEeeecCCCCCCCCCCcEEEEE
Confidence 99999999999986 7899999999999999999999997641 23445689999999999999875 4679999999
Q ss_pred EecCCCCccceEEEEEeecCchhHHHHHHHH-------hcCCC--Cc---EEecCCCChhhHHHHHHHHHHHHHHHHHhh
Q 001599 800 ASQDWPEVTKYAGLVCAQAHRQELIQDLFKT-------WQDPG--TP---YIFPDGVSEGQFYQVLLYELDAIRKACASL 867 (1047)
Q Consensus 800 aS~D~~~~~ky~~~~~~Q~~r~EiI~~l~~~-------~~~~~--~P---IiyRDGVSEgQf~~Vl~~El~~Ik~A~~~l 867 (1047)
||+| .++++|.+.+++|.+++|+|++|.++ |++.+ .| ||||||||||||.+|+++|+++|++||.++
T Consensus 225 as~d-~~~~~y~~~~~~q~~~~e~i~~l~~~~~~~l~~~~~~~~~~P~~IiiyRDGvsegq~~~v~~~E~~~i~~a~~~~ 303 (426)
T cd04657 225 ASVD-WHLAQYPASVRLQSHRQEIIDDLESMVRELLRAFKKATGKLPERIIYYRDGVSEGQFAQVLNEELPAIRKACAKL 303 (426)
T ss_pred EecC-CcccccceEEEEeCCCcchHHHHHHHHHHHHHHHHHHhCCCCceEEEEEcCcCHHHHHHHHHHHHHHHHHHHHHh
Confidence 9999 99999999999999999998876555 44332 35 999999999999999999999999999999
Q ss_pred CCCCCCCEEEEEEeecccccccccCCCCCCcCCCCCCCcCceeccCcccCCCcccEEeeeccCCcccccCCeEEEEecCC
Q 001599 868 EPNYQPPVTFVVVQKRHHTRLFANNHHDRNAVDRSGNILPGTVVDSKICHPTEFDFYLCSHAGIQGTSRPAHYHVLWDEN 947 (1047)
Q Consensus 868 ~~~~~P~iT~Ivv~KRHhtRff~~~~~~~~~~~~~~N~~pGTVVD~~It~p~~~DFyL~Sh~~~qGTsrPthY~VL~De~ 947 (1047)
+++|+|+||||||+||||||||+.+..+. ..+.+||+||||||++||+|..||||||||.++|||||||||+||+||+
T Consensus 304 ~~~~~pkit~ivv~Krh~~Rff~~~~~~~--~~~~~N~~pGTvVd~~it~p~~~dFyL~sh~~~qGTarPt~Y~vl~d~~ 381 (426)
T cd04657 304 YPGYKPKITFIVVQKRHHTRFFPTDEDDA--DGKNGNVPPGTVVDRGITHPREFDFYLCSHAGIQGTARPTHYHVLWDEI 381 (426)
T ss_pred ccCCCCcEEEEEeccceeeeEeccCcccc--cccCCCCCCCeEEecccCCCCceeEEEeccccCccCCCCceEEEEECCC
Confidence 88899999999999999999999876542 1237999999999999999999999999999999999999999999999
Q ss_pred CCCHHHHHHHHHHhhcccccccCccccCcHHHHHHHHHHHHhhhc
Q 001599 948 KFTADGLQSLTNNLCYTYARCTRSVSIVPPAYYAHLAAFRARFYM 992 (1047)
Q Consensus 948 ~~~~d~Lq~LT~~LCy~y~r~t~sVSip~P~yYA~l~a~Rar~~~ 992 (1047)
++++|+||+|||+|||+|+|||++||||+|+||||++|+|||+||
T Consensus 382 ~~~~d~lq~lt~~lc~~y~~~~~~vsip~p~~yA~~la~r~r~~~ 426 (426)
T cd04657 382 GFTADELQTLTYNLCYTYARCTRSVSIPPPAYYAHLAAARARCYL 426 (426)
T ss_pred CCCHHHHHHHHHHHhhcccccCCCcccchHHHHHHHHHHHHhhcC
Confidence 999999999999999999999999999999999999999999996
No 5
>cd04658 Piwi_piwi-like_Euk Piwi_piwi-like_Euk: PIWI domain, Piwi-like subfamily found in eukaryotes. This domain is found in Piwi and closely related proteins, where it is believed to perform a crucial role in germline cells, via RNA silencing. RNA silencing refers to a group of related gene-silencing mechanisms mediated by short RNA molecules, including siRNAs, miRNAs, and heterochromatin-related guide RNAs. The mechanism in Piwi is believed to be similar to that in Argonaute, the central component of the RNA-induced silencing complex (RISC). The PIWI domain is the C-terminal portion of Argonaute and consists of two subdomains, one of which provides the 5' anchoring of the guide RNA and the other, the catalytic site for slicing.
Probab=100.00 E-value=1.5e-92 Score=834.79 Aligned_cols=427 Identities=30% Similarity=0.460 Sum_probs=373.6
Q ss_pred HHHHHHHhhcCCchHHHHHHHHHHHhccCCCC--ccccccCeEEcccceEeeeEEeCCCceeecCCCCccccCCCCccee
Q 001599 534 QITALLKVTCQRPHERERDIMQTVHHNAYHED--PYAREFGIKISEKLASVEARILPAPWLKYHDTGKEKDCLPQVGQWN 611 (1047)
Q Consensus 534 q~~~mik~a~~~P~~R~~~I~~~~~~~~~~~~--~~l~~fGi~i~~~~~~v~grvL~~P~i~y~~~~~~~~~~p~~G~Wn 611 (1047)
.+++|+++++.+|.+|++.|.++++.+.++.+ ++|++|||+|+++|++|+||+|+||.|.|+++. ...+..++|+
T Consensus 2 ~m~~l~~~~~~~P~eR~~~i~~~~~~~~~~~~~~~~l~~~gi~i~~~~~~v~~rvL~~P~i~~~~~~---~~~~~~~~w~ 78 (448)
T cd04658 2 LMKELAEHTKLNPKERYDTIRQFIQRIQKNPSVQELLKKWGIELDSNPLKIQGRVLPPEQIIMGNVF---VYANSNADWK 78 (448)
T ss_pred hHHHHHHHhCCCHHHHHHHHHHHHHHhcCCCchHHHHHHCCeEEcCCceEEeeEEeCCCeEEeCCCc---cCCCCCCCcc
Confidence 47899999999999999999999988877665 589999999999999999999999999998742 1235678887
Q ss_pred c--cCceeeeCcccceeEEEEecCcchhHHHHHHHHHHHHHHHhcCcccCCCCcccCCCCCchhHHHHHHHHHHHHHhhh
Q 001599 612 M--MNKKMVNGGTVNHWICINFSRHVQDSIARGFCFELAQMCYISGMAFNPEPVIPPISARPEHVEKVLKTRYHDAMTKL 689 (1047)
Q Consensus 612 l--~~~kf~~~~~l~~W~~v~~~~~~~~~~~~~f~~~l~~~~~~~Gm~i~~~p~~~~~~~~~~~~~~~l~~~~~~~~~~~ 689 (1047)
+ .+.+|+++.++++|+++++. .+.+.++.|++.|.+.|+.+||.+..+..+.+...+.+++.+.|++.+.
T Consensus 79 ~~~~~~~~~~~~~~~~W~vi~~~--~~~~~~~~f~~~l~~~~~~~G~~~~~P~~~~~~~~~~~~~~~~l~~~~~------ 150 (448)
T cd04658 79 REIRNQPLYDAVNLNNWVLIYPS--RDQREAESFLQTLKQVAGPMGIQISPPKIIKVKDDRIETYIRALKDAFR------ 150 (448)
T ss_pred hhhcCCcccCCcccCeEEEEEec--CCHHHHHHHHHHHHHHHHHcCCccCCCeEEEeCCCCHHHHHHHHHHhhc------
Confidence 5 46678999999999999875 3467899999999999999999997744444433334455555544332
Q ss_pred cCCCCceEEEEEeeCCCCchhhhhhHhhhcccCceeEeEeecccccc--cHHHHHHHHHHHHHhcCccccccccccccCC
Q 001599 690 GQGKELDLLIVILPDNNGSLYGDLKRICETDLGLVSQCCLTKHVFKM--SKQYMANVALKINVKVGGRNTVLVDAISRRI 767 (1047)
Q Consensus 690 ~~~~~~~lvlvilp~~~~~~Y~~IK~~~d~~~GI~TQcv~~~~~~k~--~~q~~~Nv~lKiN~KlGG~N~~l~~~~~~~~ 767 (1047)
.+++|+|||||+++.++|..||++|+.++||+||||..+++.+. ..+++.||+||||+||||+||.|+..
T Consensus 151 ---~~~~lvvvilp~~~~~~Y~~iK~~~~~~~gI~tQ~i~~~t~~~~~~~~~~~~ni~lkinaKlGG~~w~l~~~----- 222 (448)
T cd04658 151 ---SDPQLVVIILPGNKKDLYDAIKKFCCVECPVPSQVITSRTLKKKKNLRSIASKIALQINAKLGGIPWTVEIP----- 222 (448)
T ss_pred ---CCCcEEEEEECCCCchhHHHHHHHhhcccCcCCEEEehhhcccccccHHHHHHHHHHHHHHhCCcceEeccC-----
Confidence 46999999999988889999999999999999999999999864 56899999999999999999998753
Q ss_pred CCcCCCCeEEEeeeecCCCCCCCCCCcEEEEEEecCCCCccceEEEEEeecCchhH-HHHHHHH-------hcCCC--Cc
Q 001599 768 PLVSDRPTIIFGADVTHPHPGEDSSPSIAAVVASQDWPEVTKYAGLVCAQAHRQEL-IQDLFKT-------WQDPG--TP 837 (1047)
Q Consensus 768 p~~~~~~tmiiG~DVtHp~~g~~~~pSiaavVaS~D~~~~~ky~~~~~~Q~~r~Ei-I~~l~~~-------~~~~~--~P 837 (1047)
.....+|||||+||+||++. ..|||+|+|||+| .++++|.+.++.|..++|+ +++|.++ |++.+ .|
T Consensus 223 -~~~~~~tmiiGidv~h~~~~--~~~Si~a~vas~~-~~~~~~~~~~~~q~~~~e~~~~~l~~~~~~~l~~y~~~~~~~P 298 (448)
T cd04658 223 -PFILKNTMIVGIDVYHDTIT--KKKSVVGFVASLN-KSITKWFSKYISQVRGQEEIIDSLGKSMKKALKAYKKENKKLP 298 (448)
T ss_pred -CCCCCCeEEEEEeeecCCCC--CCCcEEEEEEEcC-CCCceEeeEEEEeCCCceeeHHHHHHHHHHHHHHHHHHhCCCC
Confidence 13357899999999999873 4699999999999 9999999999999998887 6665444 54432 25
Q ss_pred ---EEecCCCChhhHHHHHHHHHHHHHHHHHhhCCCCCCCEEEEEEeecccccccccCCCCCCcCCCCCCCcCceeccCc
Q 001599 838 ---YIFPDGVSEGQFYQVLLYELDAIRKACASLEPNYQPPVTFVVVQKRHHTRLFANNHHDRNAVDRSGNILPGTVVDSK 914 (1047)
Q Consensus 838 ---IiyRDGVSEgQf~~Vl~~El~~Ik~A~~~l~~~~~P~iT~Ivv~KRHhtRff~~~~~~~~~~~~~~N~~pGTVVD~~ 914 (1047)
||||||||||||.+|+++|+++|++||.++..+|+|+||||+|+||||+|||+.+.. ..+||+||||||++
T Consensus 299 ~~IiiyRdGvsegq~~~v~~~E~~~i~~a~~~~~~~~~p~it~ivv~Kr~~~Rff~~~~~------~~~N~~~GTvVd~~ 372 (448)
T cd04658 299 SRIIIYRDGVGDGQLKKVKEYEVPQIKKAIKQYSENYSPKLAYIVVNKRINTRFFNQGGN------NFSNPPPGTVVDSE 372 (448)
T ss_pred ceEEEEecCCCHHHHHHHHHHHHHHHHHHHHHhCCCCCCCEEEEEEeccccceeecCCCC------CCCCCCCCcEeccc
Confidence 899999999999999999999999999998888999999999999999999997642 45899999999999
Q ss_pred ccCCCcccEEeeeccCCcccccCCeEEEEecCCCCCHHHHHHHHHHhhcccccccCccccCcHHHHHHHHHHHHh
Q 001599 915 ICHPTEFDFYLCSHAGIQGTSRPAHYHVLWDENKFTADGLQSLTNNLCYTYARCTRSVSIVPPAYYAHLAAFRAR 989 (1047)
Q Consensus 915 It~p~~~DFyL~Sh~~~qGTsrPthY~VL~De~~~~~d~Lq~LT~~LCy~y~r~t~sVSip~P~yYA~l~a~Rar 989 (1047)
||||..|||||+||.++|||||||||+||+||+++++|+||+|||+|||+|+|||++||||+|+||||++|+|+.
T Consensus 373 it~p~~~dFyL~s~~~~qGtarP~~Y~Vl~d~~~~~~~~lq~lt~~lc~~y~~~~~~vs~P~p~~yA~~~a~~~g 447 (448)
T cd04658 373 ITKPEWYDFFLVSQSVRQGTVTPTHYNVLYDTTGLKPDHLQRLTYKLCHLYYNWSGSIRVPAPCQYAHKLAFLVG 447 (448)
T ss_pred ccCCCcccEEEeccccCccCCCCceEEEEECCCCCCHHHHHHHHHHhhhcccCCCCCCccCHHHHHHHHHHHHhc
Confidence 999999999999999999999999999999999999999999999999999999999999999999999999864
No 6
>cd02826 Piwi-like Piwi-like: PIWI domain. Domain found in proteins involved in RNA silencing. RNA silencing refers to a group of related gene-silencing mechanisms mediated by short RNA molecules, including siRNAs, miRNAs, and heterochromatin-related guide RNAs. The central component of the RNA-induced silencing complex (RISC) and related complexes is Argonaute. The PIWI domain is the C-terminal portion of Argonaute and consists of two subdomains, one of which provides the 5' anchoring of the guide RNA and the other, the catalytic site for slicing. This domain is also found in closely related proteins, including the Piwi subfamily, where it is believed to perform a crucial role in germline cells, via a similar mechanism.
Probab=100.00 E-value=2e-85 Score=760.61 Aligned_cols=374 Identities=31% Similarity=0.461 Sum_probs=319.5
Q ss_pred ceEeeeEEeCCCceeecCCCCccccCCCCcceeccCceeeeCccc-ceeEEEEecCcchhHHHHHHHHHHHHHHHhcCcc
Q 001599 579 LASVEARILPAPWLKYHDTGKEKDCLPQVGQWNMMNKKMVNGGTV-NHWICINFSRHVQDSIARGFCFELAQMCYISGMA 657 (1047)
Q Consensus 579 ~~~v~grvL~~P~i~y~~~~~~~~~~p~~G~Wnl~~~kf~~~~~l-~~W~~v~~~~~~~~~~~~~f~~~l~~~~~~~Gm~ 657 (1047)
+++|+|||||||.|.|+++ |++++++|++++.+ ++|+|+++.+ +..++|++.|.+.|+.+||.
T Consensus 2 ~~~v~grvL~~p~i~~~~~------------w~~~~~~f~~~~~~~~~W~vi~~~~----~~~~~f~~~l~~~~~~~G~~ 65 (393)
T cd02826 2 PLILKGRVLPKPQILFKNK------------FLRNIGPFEKPAKITNPVAVIAFRN----EEVDDLVKRLADACRQLGMK 65 (393)
T ss_pred ceEEeeEecCCCceEecCC------------ccccCCeeCCCCEeCCeEEEEEccc----HHHHHHHHHHHHHHHhCCCc
Confidence 6899999999999999751 99999999999999 9999998853 23568999999999999999
Q ss_pred cCC-CCcccCCCCCchhHHHHHHHHHHHHHhhhcCCCCceEEEEEeeCCCCchhhhhhHhhhcccCceeEeEeeccccc-
Q 001599 658 FNP-EPVIPPISARPEHVEKVLKTRYHDAMTKLGQGKELDLLIVILPDNNGSLYGDLKRICETDLGLVSQCCLTKHVFK- 735 (1047)
Q Consensus 658 i~~-~p~~~~~~~~~~~~~~~l~~~~~~~~~~~~~~~~~~lvlvilp~~~~~~Y~~IK~~~d~~~GI~TQcv~~~~~~k- 735 (1047)
+.. ++...+... .+ -.+.+.+.++++.+ .+++|||||||+++.++|+.||++|+.+ ||+||||+.+|+.+
T Consensus 66 ~~~~~~~~~~~~~-~~-~~~~~~~~~~~~~~-----~~~~lv~~ilp~~~~~~Y~~iK~~~~~~-gI~tQ~i~~~t~~~~ 137 (393)
T cd02826 66 IKEIPIVSWIEDL-NN-SFKDLKSVFKNAIK-----AGVQLVIFILKEKKPPLHDEIKRLEAKS-DIPSQVIQLKTAKKM 137 (393)
T ss_pred cCCCCCcceeecc-cc-cHHHHHHHHHHHhh-----cCCCEEEEEEcCCCccHHHHHHHHHhcc-CCceEEEehhhhccc
Confidence 976 332222111 11 11223333333322 4699999999999889999999999988 99999999999976
Q ss_pred -ccHHHHHHHHHHHHHhcCccccccccccccCCCCcCCCCeEEEeeeecCCCCC-CCCCCcEEEEEEecCCCCccceEEE
Q 001599 736 -MSKQYMANVALKINVKVGGRNTVLVDAISRRIPLVSDRPTIIFGADVTHPHPG-EDSSPSIAAVVASQDWPEVTKYAGL 813 (1047)
Q Consensus 736 -~~~q~~~Nv~lKiN~KlGG~N~~l~~~~~~~~p~~~~~~tmiiG~DVtHp~~g-~~~~pSiaavVaS~D~~~~~ky~~~ 813 (1047)
.+++|++||+||||+||||+||.|+.. .+...+|||||+||+||+++ ....||++|+|||+| .+ +.+.+.
T Consensus 138 ~~~~~~~~Ni~lkin~KlGG~~~~l~~~------~~~~~~tmiiGiDv~h~~~~~~~~~~si~~~vas~~-~~-~~~g~~ 209 (393)
T cd02826 138 RRLKQTLDNLLRKVNSKLGGINYILDSP------VKLFKSDIFIGFDVSHPDRRTVNGGPSAVGFAANLS-NH-TFLGGF 209 (393)
T ss_pred cccHHHHHHHHHHHhhhhCCeeeEeccC------CCCCCCEEEEEEEeeCCCCCCCCCCCcEEEEEeecC-Cc-cccceE
Confidence 678999999999999999999999753 12357899999999999886 345799999999999 65 444567
Q ss_pred EEeecCchhHHHHHHHH-------hcCC--C-Cc---EEecCCCChhhHHHHHHHHHHHHHHHHHhhCCCCCCCEEEEEE
Q 001599 814 VCAQAHRQELIQDLFKT-------WQDP--G-TP---YIFPDGVSEGQFYQVLLYELDAIRKACASLEPNYQPPVTFVVV 880 (1047)
Q Consensus 814 ~~~Q~~r~EiI~~l~~~-------~~~~--~-~P---IiyRDGVSEgQf~~Vl~~El~~Ik~A~~~l~~~~~P~iT~Ivv 880 (1047)
++.|..++|++++|.++ |++. . .| ||||||||||||++|+++|+++|++||. ++.+|+|+||||||
T Consensus 210 ~~~~~~~~~~~~~l~~~~~~~L~~y~~~~~~~~P~~IiiyRDGvsegq~~~v~~~e~~~i~~a~~-~~~~~~p~it~Ivv 288 (393)
T cd02826 210 LYVQPSREVKLQDLGEVIKKCLDGFKKSTGEGLPEKIVIYRDGVSEGEFKRVKEEVEEIIKEACE-IEESYRPKLVIIVV 288 (393)
T ss_pred EEEecCccchHHHHHHHHHHHHHHHHHHcCCCCcceeEEEecCCCHHHHHHHHHHHHHHHHHHHh-hCCCCCCCEEEEEE
Confidence 88898888877665444 4432 2 45 8999999999999999999999999999 77789999999999
Q ss_pred eecccccccccCCCCCCcCCCCCCCcCceeccCcccCCCcccEEeeeccCCcccccCCeEEEEecCCCCCHHHHHHHHHH
Q 001599 881 QKRHHTRLFANNHHDRNAVDRSGNILPGTVVDSKICHPTEFDFYLCSHAGIQGTSRPAHYHVLWDENKFTADGLQSLTNN 960 (1047)
Q Consensus 881 ~KRHhtRff~~~~~~~~~~~~~~N~~pGTVVD~~It~p~~~DFyL~Sh~~~qGTsrPthY~VL~De~~~~~d~Lq~LT~~ 960 (1047)
+||||+|||+.+.++ ..+||+||||||++||||..+||||+||.++|||+||+||+||+||+++++|+||+|||+
T Consensus 289 ~Krh~~Rff~~~~~~-----~~~Np~~GTvVd~~it~p~~~dFyL~sh~~~qGT~rP~~Y~Vl~d~~~~~~d~lq~lty~ 363 (393)
T cd02826 289 QKRHNTRFFPNEKNG-----GVQNPEPGTVVDHTITSPGLSEFYLASHVARQGTVKPTKYTVVFNDKNWSLNELEILTYI 363 (393)
T ss_pred eccccceeccCCCCC-----CCCCCCCceEeccccccCCcceEEEeccccCcCCCCCceEEEEECCCCCCHHHHHHHHHH
Confidence 999999999986543 348999999999999999999999999999999999999999999999999999999999
Q ss_pred hhcccccccCccccCcHHHHHHHHHHHHhh
Q 001599 961 LCYTYARCTRSVSIVPPAYYAHLAAFRARF 990 (1047)
Q Consensus 961 LCy~y~r~t~sVSip~P~yYA~l~a~Rar~ 990 (1047)
|||+|+|||++||||+|+||||++|+|||+
T Consensus 364 lc~~y~~~~~~vslP~p~~yA~~~a~r~rn 393 (393)
T cd02826 364 LCLTHQNVYSPISLPAPLYYAHKLAKRGRN 393 (393)
T ss_pred HhhcccccCCCcccChHHHHHHHHHHhhcC
Confidence 999999999999999999999999999985
No 7
>PF02171 Piwi: Piwi domain; InterPro: IPR003165 This domain is found in the stem cell self-renewal protein Piwi and its relatives in Drosophila melanogaster []. It has been found in the C-terminal of a number of proteins which also contain the PAZ domain (IPR003100 from INTERPRO) in their central region, for example the Argonaute proteins. Several of these proteins have been implicated in the development and maintenance of stem cells through the RNA-mediated gene-quelling mechanisms associated with the protein DICER. ; GO: 0005515 protein binding; PDB: 4F1N_B 3LUH_B 4EI1_A 3QX8_A 3LUC_C 3LUJ_B 3LUD_B 3QX9_A 3LUG_B 3LUK_B ....
Probab=100.00 E-value=3.1e-69 Score=607.06 Aligned_cols=287 Identities=46% Similarity=0.742 Sum_probs=250.6
Q ss_pred EEEEEeeCCCCchhhhhhHhhhcccCceeEeEeecccccc--cHHHHHHHHHHHHHhcCccccccccccccCCCCcCCCC
Q 001599 697 LLIVILPDNNGSLYGDLKRICETDLGLVSQCCLTKHVFKM--SKQYMANVALKINVKVGGRNTVLVDAISRRIPLVSDRP 774 (1047)
Q Consensus 697 lvlvilp~~~~~~Y~~IK~~~d~~~GI~TQcv~~~~~~k~--~~q~~~Nv~lKiN~KlGG~N~~l~~~~~~~~p~~~~~~ 774 (1047)
|||||||+++.+.|..||++|+.++||+||||..+++.+. ..+++.||+||||+||||+|+.+.+. ....++ .+
T Consensus 1 ~i~~ii~~~~~~~Y~~iKk~~~~~~gi~tQ~i~~~~~~~~~~~~~~~~ni~lkinaKlGG~n~~~~~~-~~~~~~---~~ 76 (302)
T PF02171_consen 1 LIVVIIPDKNSDNYHAIKKYLERKLGIPTQCILSKTLRKKNKSKQILNNIALKINAKLGGINPWLLDS-PPSIDL---KN 76 (302)
T ss_dssp -EEEEESSSSHHHHHHHHHHHHTTTTCEEEEEEHHHHHTSTHHHHHHHHHHHHHHHHTTTBSEEECSC-SSGSSE---SE
T ss_pred CEEEEEeCCChhHHHHHHHHHccCCCcccEEEccCcccccchHHHHHHHHHHHHHHhCCCeeeeeccc-cccccc---Cc
Confidence 5899999988899999999999999999999999999887 46999999999999999997544332 011111 68
Q ss_pred eEEEeeeecCCCCCCCCCCcEEEEEEecCCCCccceEEEEEeecCchhHHHHHHH-------HhcCCC---Cc---EEec
Q 001599 775 TIIFGADVTHPHPGEDSSPSIAAVVASQDWPEVTKYAGLVCAQAHRQELIQDLFK-------TWQDPG---TP---YIFP 841 (1047)
Q Consensus 775 tmiiG~DVtHp~~g~~~~pSiaavVaS~D~~~~~ky~~~~~~Q~~r~EiI~~l~~-------~~~~~~---~P---IiyR 841 (1047)
|||||+||+|++++....||++|+|+|+| .+.++|.+.++.|..++|++++|.+ .|++.+ .| ||||
T Consensus 77 ~miIGidv~h~~~~~~~~~sv~g~~~s~~-~~~~~~~~~~~~~~~~~e~~~~l~~~~~~~L~~~~~~~~~~~P~~IiiyR 155 (302)
T PF02171_consen 77 TMIIGIDVSHPSPGSDKNPSVVGFVASFD-SDGSKYFSSVRFQDSGQEIIDNLEEIIKEALKEFKKNNGKWLPERIIIYR 155 (302)
T ss_dssp EEEEEEEEEEESSTCTCSCEEEEEEEEES-TTTCEEEEEEEEECTTCCCHHHHHHHHHHHHHHHHHTTTT-TTSEEEEEE
T ss_pred eEEEEEEEEecCcccCCcceeeEEEEecc-CccccccceeEEeccchhhhcchhhHHHHHHHHHHHHcCCCCCceEEEEE
Confidence 99999999999987656799999999999 9999999999999998887776433 354322 36 8999
Q ss_pred CCCChhhHHHHHHHHHHHHHHHHHhhCCCCCCCEEEEEEeecccccccccCCCCCCcCCCCCCCcCceeccCcccCCCcc
Q 001599 842 DGVSEGQFYQVLLYELDAIRKACASLEPNYQPPVTFVVVQKRHHTRLFANNHHDRNAVDRSGNILPGTVVDSKICHPTEF 921 (1047)
Q Consensus 842 DGVSEgQf~~Vl~~El~~Ik~A~~~l~~~~~P~iT~Ivv~KRHhtRff~~~~~~~~~~~~~~N~~pGTVVD~~It~p~~~ 921 (1047)
||||||||.+|+++|+++|++||+++..+|.|+||||+|+||||+|||+.+..+ ...||+||||||+.||+|..+
T Consensus 156 dGvse~~~~~v~~~Ei~~i~~a~~~~~~~~~p~~~~i~v~K~~~~R~f~~~~~~-----~~~N~~~Gtvvd~~i~~~~~~ 230 (302)
T PF02171_consen 156 DGVSEGQFKKVLEEEIEAIKEAIKELGEDYNPKITYIVVQKRHNTRFFPQNGRD-----GLQNPPPGTVVDTGITSPNYF 230 (302)
T ss_dssp ES--GGGHHHHHHHHHHHHHHHHHHHTHTTCTEEEEEEEESSSS--EEESSSEE-----TTTEECTTEEESSEEEECSBE
T ss_pred cccCHHhhcccHHHHHHHHHHHHhhcccCCCCcEEEEEeeccccceEeeccccc-----ccCCCCCCeeeccceeeecce
Confidence 999999999999999999999999999899999999999999999999987642 578999999999999999999
Q ss_pred cEEeeeccCCcccccCCeEEEEecCCCCCHHHHHHHHHHhhcccccccCccccCcHHHHHHHHHHHHhhhcC
Q 001599 922 DFYLCSHAGIQGTSRPAHYHVLWDENKFTADGLQSLTNNLCYTYARCTRSVSIVPPAYYAHLAAFRARFYME 993 (1047)
Q Consensus 922 DFyL~Sh~~~qGTsrPthY~VL~De~~~~~d~Lq~LT~~LCy~y~r~t~sVSip~P~yYA~l~a~Rar~~~~ 993 (1047)
||||+||.++|||+||+||+||+||.+++.|+||+|||+|||+|+||+++||+|+|+||||++|+|++.++.
T Consensus 231 ~f~l~s~~~~~Gt~~P~~y~vl~~~~~~~~~~l~~~t~~L~~~~~~~~~~~~lP~p~~yA~~~a~~~~~~~~ 302 (302)
T PF02171_consen 231 EFYLVSHTARQGTARPTHYTVLYDDSNLSMDELQQLTYSLCHLYQNSTGPISLPAPLYYAHKLAKRGRNNLK 302 (302)
T ss_dssp EEEEETSCCCSSSEEEEEEEEEEESSCSCHHHHHHHHHHHTTGGTTSSS--SS-HHHHHHHHHHHHHHHHC-
T ss_pred eeeeeecccccccccccEEEEecCcccccHHHHHHHHHHHHHHhcccCCCCccCHHHHHHHHHHHHHHhhcC
Confidence 999999999999999999999999999999999999999999999999999999999999999999999873
No 8
>cd04659 Piwi_piwi-like_ProArk Piwi_piwi-like_ProArk: PIWI domain, Piwi-like subfamily found in Archaea and Bacteria. RNA silencing refers to a group of related gene-silencing mechanisms mediated by short RNA molecules, including siRNAs, miRNAs, and heterochromatin-related guide RNAs. The central component of the RNA-induced silencing complex (RISC) and related complexes is Argonaute. The PIWI domain is the C-terminal portion of Argonaute and consists of two subdomains, one of which provides the 5' anchoring of the guide RNA and the other, the catalytic site for slicing. This domain is also found in closely related proteins, including the Piwi subfamily, where it is believed to perform a crucial role in germline cells, via a similar mechanism.
Probab=100.00 E-value=2.9e-44 Score=419.17 Aligned_cols=264 Identities=22% Similarity=0.223 Sum_probs=209.3
Q ss_pred CCceEEEEEeeCCC------CchhhhhhHhhhcccCceeEeEeecccccc--cHHHHHHHHHHHHHhcCccccccccccc
Q 001599 693 KELDLLIVILPDNN------GSLYGDLKRICETDLGLVSQCCLTKHVFKM--SKQYMANVALKINVKVGGRNTVLVDAIS 764 (1047)
Q Consensus 693 ~~~~lvlvilp~~~------~~~Y~~IK~~~d~~~GI~TQcv~~~~~~k~--~~q~~~Nv~lKiN~KlGG~N~~l~~~~~ 764 (1047)
..++++|||||++. .++|..||++| .++||+||||..+|+.+. ..+++.||+||||+||||+||.|...
T Consensus 109 ~~~~~~lvilP~~~~~~~~~~~~Y~~iK~~~-~~~giptQ~v~~~tl~~~~~~~~~~~nial~i~aKlGG~pW~l~~~-- 185 (404)
T cd04659 109 QGVDVVIVVLPEDLKELPEEFDLYDRLKAKL-LRLGIPTQFVREDTLKNRQDLAYVAWNLALALYAKLGGIPWKLDAD-- 185 (404)
T ss_pred CCCCEEEEEeCHHHhhcccccCHHHHHHHHH-HhcCCceEEeeHHHcCccccHHHHHHHHHHHHHHhcCCCceEcccC--
Confidence 46899999999875 78999999997 679999999999999764 57899999999999999999998642
Q ss_pred cCCCCcCCCCeEEEeeeecCCCCCCCCCCcEEEEEEecCCCCc--cceEEEEEeecC----chhHHHHHHHHhcCC--C-
Q 001599 765 RRIPLVSDRPTIIFGADVTHPHPGEDSSPSIAAVVASQDWPEV--TKYAGLVCAQAH----RQELIQDLFKTWQDP--G- 835 (1047)
Q Consensus 765 ~~~p~~~~~~tmiiG~DVtHp~~g~~~~pSiaavVaS~D~~~~--~ky~~~~~~Q~~----r~EiI~~l~~~~~~~--~- 835 (1047)
...+|||||+||+|+..+....+++|+|+ +.|.... ..+......+.. -.+++.+.++.|++. .
T Consensus 186 ------~~~~~~iIGidv~~~~~~~~~~~~~a~vf-~~~g~g~~~~~~~~~~~~~~~~~~~~~~~l~~~l~~y~~~~~~~ 258 (404)
T cd04659 186 ------SDPADLYIGIGFARSRDGEVRVTGCAQVF-DSDGLGLILRGAPIEEPTEDRSPADLKDLLKRVLEGYRESHRGR 258 (404)
T ss_pred ------CCCCeEEEEEEEEEcCCCCEEEEEEEEEE-cCCCCEEEEecCccCCcccccCHHHHHHHHHHHHHHHHHHcCCC
Confidence 24689999999999986533335555443 3331010 111112222211 123344444455442 2
Q ss_pred Cc---EEecCCCChhhHHHHHHHHHHHHHHHHHhhCCCCCCCEEEEEEeecccccccccCCCCCCcCCCCCCCcCceecc
Q 001599 836 TP---YIFPDGVSEGQFYQVLLYELDAIRKACASLEPNYQPPVTFVVVQKRHHTRLFANNHHDRNAVDRSGNILPGTVVD 912 (1047)
Q Consensus 836 ~P---IiyRDGVSEgQf~~Vl~~El~~Ik~A~~~l~~~~~P~iT~Ivv~KRHhtRff~~~~~~~~~~~~~~N~~pGTVVD 912 (1047)
.| ||||||+. .++|+++|++||.++. |+|+||+|+||||+|||+.+..+ ...||++|||||
T Consensus 259 ~P~rIiihrdg~~-------~~~E~~~i~~a~~~~~----~~i~~I~V~k~~~~R~f~~~~~~-----~~~np~~GT~v~ 322 (404)
T cd04659 259 DPKRLVLHKDGRF-------TDEEIEGLKEALEELG----IKVDLVEVIKSGPHRLFRFGTYP-----NGFPPRRGTYVK 322 (404)
T ss_pred CCeEEEEECCCCC-------CHHHHHHHHHHHHhhC----ceEEEEEEEecCCcceEEecCCC-----CCCCCCCceEEE
Confidence 35 89999993 7999999999999874 89999999999999999976532 127999999999
Q ss_pred CcccCCCcccEEeeeccCC--------cccccCCeEEEEecCCCCCHHHHHHHHHHhhcccccccC-ccccCcHHHHHHH
Q 001599 913 SKICHPTEFDFYLCSHAGI--------QGTSRPAHYHVLWDENKFTADGLQSLTNNLCYTYARCTR-SVSIVPPAYYAHL 983 (1047)
Q Consensus 913 ~~It~p~~~DFyL~Sh~~~--------qGTsrPthY~VL~De~~~~~d~Lq~LT~~LCy~y~r~t~-sVSip~P~yYA~l 983 (1047)
.. .+||||++|... +||+||+| |++|+.+++.|+|+++||.||++|+|++. ++++|+|+||||+
T Consensus 323 ~~-----~~~~~L~s~g~~~~~~~~~~~gtp~Pl~--v~~~~~~~~~~~l~~~~~~Lt~~~~n~~~~~~~lP~ti~YA~~ 395 (404)
T cd04659 323 LS-----DDEGLLWTHGSVPKYNTYPGMGTPRPLL--LRRHSGNTDLEQLASQILGLTKLNWNSFQFYSRLPVTIHYADR 395 (404)
T ss_pred eC-----CCeEEEEecCCccccccCCCCCCCCcEE--EEEccCCCCHHHHHHHHHHHhhcCcCCCCCCCCcceEEeHHHH
Confidence 64 599999999986 99999999 88899999999999999999999999999 9999999999999
Q ss_pred HHHHHh
Q 001599 984 AAFRAR 989 (1047)
Q Consensus 984 ~a~Rar 989 (1047)
+|+...
T Consensus 396 ~a~~~~ 401 (404)
T cd04659 396 VAKLLK 401 (404)
T ss_pred HHHHHh
Confidence 998754
No 9
>PF02170 PAZ: PAZ domain; InterPro: IPR003100 This domain is named after the proteins Piwi Argonaut and Zwille. It is also found in the CAF protein from Arabidopsis thaliana. The function of the domain is unknown but has been found in the middle region of a number of members of the Argonaute protein family, which also contain the Piwi domain (IPR003165 from INTERPRO) in their C-terminal region []. Several members of this family have been implicated in the development and maintenance of stem cells through the RNA-mediated gene-quelling mechanisms associated with the protein DICER. ; GO: 0005515 protein binding; PDB: 1R6Z_P 1T2R_A 1T2S_A 3MJ0_A 1VYN_A 3O3I_X 2L5C_A 3O6E_X 3O7V_X 2L5D_A ....
Probab=99.88 E-value=6.6e-23 Score=202.96 Aligned_cols=133 Identities=34% Similarity=0.609 Sum_probs=109.5
Q ss_pred ccHHHHHHHHhcCCCCCCCCChHHHHHHHHHccceEEEEeecCCcCceEEEeccCCCCCcceeeeecCCCceeeHHHHHH
Q 001599 408 LPVIDFVQQLLNRDVSSRPLSDADRVKIKKALRGVRVEVTHRGNMRRKYRISGLTSQTTGELTFPVDESGTLKSVVEYFY 487 (1047)
Q Consensus 408 ~~l~d~~~~~~~~~~~~~~~~~~~~~~l~~~L~gl~V~~~~~~~~~r~~~I~~i~~~~a~~~~F~~~~~g~~isV~~Yf~ 487 (1047)
++|+|++.++.+.... .......++++.|+|++|.++|++. .+.|+|.+|++..+++.+|+.+ +|+.+||+|||+
T Consensus 1 ~~vld~~~~~~~~~~~---~~~~~~~~~~~~lkg~~V~~~~~~~-~r~~~I~~i~~~~~~~~~F~~~-~g~~itv~eYf~ 75 (135)
T PF02170_consen 1 QSVLDFLKEIQNFRQR---NNIKFQKKLERALKGLKVTTTYNNN-KRTYKIKGISFDPAPESTFPDN-DGKEITVAEYFK 75 (135)
T ss_dssp HHHHHHHHHHCTCSSH---HHHHHHHHHHHHHTTEEEEETTTTC-CEEEEEEEEEEEETTTSEEEET-TSEEEEHHHHHH
T ss_pred CcHHHHHHHHHhhhcc---cchHHHHHHHHHcCCcEEEEecCCC-ceEEEEeEEECCCCcceeeecC-CCceEEhHHHHH
Confidence 4789999998764321 1122344599999999999999853 3999999999999999999864 589999999999
Q ss_pred HHcCCccCCCCCcEEEeccCCC--CccccccceEecCCccccccCCHHHHHHHHHhhcCC
Q 001599 488 ETYGFVIQHTQWPCLQVGNQQR--PNYLPMEVCKIVEGQRYSKRLNERQITALLKVTCQR 545 (1047)
Q Consensus 488 ~~Y~i~L~~p~lP~v~~g~~~~--~~ylP~Elc~i~~gQ~~~~kl~~~q~~~mik~a~~~ 545 (1047)
++||++|+||+||||+++...+ ++|||||||.|+++|++..++...+++.|++.+|.+
T Consensus 76 ~~Y~i~L~~p~~Pll~~~~~~~~~~~~lP~Elc~i~~~q~~~~~~~~~~~s~m~r~~~~~ 135 (135)
T PF02170_consen 76 EKYNIRLKYPDLPLLNVKSKKKKQPIYLPPELCFIVPGQRYKKKLFTCQPSIMIRFACSP 135 (135)
T ss_dssp HTCT---SSTTSEEEEECSTTTTTCEEEECCGEEEETTTBB-SS--HHHHHHHHHHHSS-
T ss_pred hhhhcccccCCCCeEEeccCCCCceEEEChhHhcccCCcHHHHhccHHHHHHHHHHHhcC
Confidence 9999999999999999998777 999999999999999999999999999999999864
No 10
>cd02846 PAZ_argonaute_like PAZ domain, argonaute_like subfamily. Argonaute is part of the RNA-induced silencing complex (RISC), and is an endonuclease that plays a key role in the RNA interference pathway. The PAZ domain has been named after the proteins Piwi,Argonaut, and Zwille. PAZ is found in two families of proteins that are essential components of RNA-mediated gene-silencing pathways, including RNA interference, the Piwi and Dicer families. PAZ functions as a nucleic acid binding domain, with a strong preference for single-stranded nucleic acids (RNA or DNA) or RNA duplexes with single-stranded 3' overhangs. It has been suggested that the PAZ domain provides a unique mode for the recognition of the two 3'-terminal nucleotides in single-stranded nucleic acids and buries the 3' OH group, and that it might recognize characteristic 3' overhangs in siRNAs within RISC (RNA-induced silencing) and other complexes.
Probab=99.84 E-value=1.4e-20 Score=180.81 Aligned_cols=113 Identities=49% Similarity=0.879 Sum_probs=98.8
Q ss_pred ccHHHHHHHHhcCCCCCCCCChHHHHHHHHHccceEEEEeecCCcCceEEEeccCCCCCcceeeeecCCCceeeHHHHHH
Q 001599 408 LPVIDFVQQLLNRDVSSRPLSDADRVKIKKALRGVRVEVTHRGNMRRKYRISGLTSQTTGELTFPVDESGTLKSVVEYFY 487 (1047)
Q Consensus 408 ~~l~d~~~~~~~~~~~~~~~~~~~~~~l~~~L~gl~V~~~~~~~~~r~~~I~~i~~~~a~~~~F~~~~~g~~isV~~Yf~ 487 (1047)
++|+|+++++++..... .+++.++.++.++|+|++|.++|++...|.|+|.+|+..++.+.+|+.++.+++|||+|||+
T Consensus 2 ~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~lkgl~v~~~~~~~~~r~~~i~~l~~~~~~~~~F~~~~~~~~isV~dYf~ 80 (114)
T cd02846 2 QPVIEFLKEFLGFDTPL-GLSDNDRRKLKKALKGLKVEVTHRGNTNRKYKIKGLSAEPASQQTFELKDGEKEISVADYFK 80 (114)
T ss_pred ccHHHHHHHHhCccccc-ccchHHHHHHHHHhCCCEEEEEcCCCCCceEEEeeccCCCccceEEEcCCCCcEEEHHHHHH
Confidence 68999999998754322 45667888999999999999999865578999999999998899998654335899999999
Q ss_pred HHcCCccCCCCCcEEEeccCCCCccccccceEec
Q 001599 488 ETYGFVIQHTQWPCLQVGNQQRPNYLPMEVCKIV 521 (1047)
Q Consensus 488 ~~Y~i~L~~p~lP~v~~g~~~~~~ylP~Elc~i~ 521 (1047)
++||++|+||+||||++|+..+++|+|||||.|+
T Consensus 81 ~~y~~~l~~p~lP~v~~g~~~~~~~~P~Elc~i~ 114 (114)
T cd02846 81 EKYNIRLKYPNLPCLQVGRKGKPNYLPMELCNIV 114 (114)
T ss_pred HHcCCcccCCCCCEEEeCCCCCCcEecceeEEeC
Confidence 9999999999999999999889999999999985
No 11
>cd02825 PAZ PAZ domain, named PAZ after the proteins Piwi Argonaut and Zwille. PAZ is found in two families of proteins that are essential components of RNA-mediated gene-silencing pathways, including RNA interference, the piwi and Dicer families. PAZ functions as a nucleic-acid binding domain, with a strong preference for single-stranded nucleic acids (RNA or DNA) or RNA duplexes with single-stranded 3' overhangs. It has been suggested that the PAZ domain provides a unique mode for the recognition of the two 3'-terminal nucleotides in single-stranded nucleic acids and buries the 3' OH group, and that it might recognize characteristic 3' overhangs in siRNAs within RISC (RNA-induced silencing) and other complexes. This parent model also contains structures of an archaeal PAZ domain.
Probab=99.82 E-value=5.5e-20 Score=176.47 Aligned_cols=112 Identities=29% Similarity=0.430 Sum_probs=97.9
Q ss_pred CccHHHHHHHHhcCCCCCCCCChHHHHHHHHHccceEEEEeecCCcCceEEEeccCCCCCcceeeeecCCCceeeHHHHH
Q 001599 407 PLPVIDFVQQLLNRDVSSRPLSDADRVKIKKALRGVRVEVTHRGNMRRKYRISGLTSQTTGELTFPVDESGTLKSVVEYF 486 (1047)
Q Consensus 407 ~~~l~d~~~~~~~~~~~~~~~~~~~~~~l~~~L~gl~V~~~~~~~~~r~~~I~~i~~~~a~~~~F~~~~~g~~isV~~Yf 486 (1047)
.++|+|+++++++.....+.+.+.++.++.++|+|++|.++|++ .++.|+|.+|++.++.+. |.. .+|+++||+|||
T Consensus 1 ~~~v~~~~~~~~~~~~~~~~~~~~~~~~~~~~lkg~~V~~~h~~-~~r~y~i~~i~~~~a~~~-f~~-~~~~~isv~dYf 77 (115)
T cd02825 1 ADPVIETMCKFPKDREIDTPLLDSPREEFTKELKGLKVEDTHNP-LNRVYRPDGETRLKAPSQ-LKH-SDGKEITFADYF 77 (115)
T ss_pred CccHHHHHHHHhcccccccccchHHHHHHHHHcCCCEEEEecCC-CceEEEEeeEECCCChhh-eec-CCCCEEEHHHHH
Confidence 36899999999876554456777788899999999999999984 468999999999998888 763 457899999999
Q ss_pred HHHcCCccCCCCCcEEEeccC---CCCccccccceEec
Q 001599 487 YETYGFVIQHTQWPCLQVGNQ---QRPNYLPMEVCKIV 521 (1047)
Q Consensus 487 ~~~Y~i~L~~p~lP~v~~g~~---~~~~ylP~Elc~i~ 521 (1047)
+++||++|+||+||||+++++ .+++|||||||.|.
T Consensus 78 ~~kY~~~l~~p~~Pll~~~~~~~~~~~~~lp~Elc~i~ 115 (115)
T cd02825 78 KERYNLTLTDLNQPLLIVKFSSKKSYSILLPPELCVIT 115 (115)
T ss_pred HHHcCCcccCCCCCEEEecCcccCCCceEEchheEEeC
Confidence 999999999999999999987 67899999999874
No 12
>cd02845 PAZ_piwi_like PAZ domain, Piwi_like subfamily. In multi-cellular organisms, the Piwi protein appears to be essential for the maintenance of germline stem cells. In the Drosophila male germline, Piwi was shown to be involved in the silencing of retrotransposons in the male gametes. The Piwi proteins share their domain architecture with other members of the argonaute family. The PAZ domain has been named after the proteins Piwi, Argonaut, and Zwille. PAZ is found in two families of proteins that are essential components of RNA-mediated gene-silencing pathways, including RNA interference, the Piwi and Dicer families. PAZ functions as a nucleic acid binding domain, with a strong preference for single-stranded nucleic acids (RNA or DNA) or RNA duplexes with single-stranded 3' overhangs. It has been suggested that the PAZ domain provides a unique mode for the recognition of the two 3'-terminal nucleotides in single-stranded nucleic acids and buries the 3' OH group, and that it might
Probab=99.71 E-value=1.9e-17 Score=158.45 Aligned_cols=106 Identities=26% Similarity=0.387 Sum_probs=90.3
Q ss_pred ccHHHHHHHHhcCCCCCCCCChHHHHHHHHHccceEEEEeecCCcCceEEEeccCCCCCcceeeeecCCCceeeHHHHHH
Q 001599 408 LPVIDFVQQLLNRDVSSRPLSDADRVKIKKALRGVRVEVTHRGNMRRKYRISGLTSQTTGELTFPVDESGTLKSVVEYFY 487 (1047)
Q Consensus 408 ~~l~d~~~~~~~~~~~~~~~~~~~~~~l~~~L~gl~V~~~~~~~~~r~~~I~~i~~~~a~~~~F~~~~~g~~isV~~Yf~ 487 (1047)
.+++|++.++++... ....+.++++.|+|++|.++|+ ++.|+|.+|+++.+++.+|+. .++..+||+|||+
T Consensus 2 ~~~~~~~~~~~~~~~-----~~~~~~~~~~~l~g~~V~t~yn---~k~Y~I~~I~~~~~p~s~F~~-~~~~~~S~~~Yy~ 72 (117)
T cd02845 2 TTVLDRMHKLYRQET-----DERFREECEKELIGSIVLTRYN---NKTYRIDDIDFDKTPLSTFKK-SDGTEITFVEYYK 72 (117)
T ss_pred eeHHHHHHHHHHhcc-----cHHHHHHHHHHcCCCEEEEeeC---CeEEEEeEecCCCCccccCcC-CCCCeeeHHHHHH
Confidence 378899988876421 1246788999999999999996 689999999999999999974 3356899999999
Q ss_pred HHcCCccCCCCCcEEEeccCC--------CCccccccceEecC
Q 001599 488 ETYGFVIQHTQWPCLQVGNQQ--------RPNYLPMEVCKIVE 522 (1047)
Q Consensus 488 ~~Y~i~L~~p~lP~v~~g~~~--------~~~ylP~Elc~i~~ 522 (1047)
++||+.|+||+||||+++.++ +++|||||||.|+.
T Consensus 73 ~kY~i~I~~~~qPLL~~~~k~~~~~~~~~~~iyL~pElC~ltg 115 (117)
T cd02845 73 KQYNIEITDLNQPLLVSRPKRRDPRGGEKEPIYLIPELCFLTG 115 (117)
T ss_pred HHcCCccccCCCCcEEeeccccccCCCCCcEEEEchHHhhhcC
Confidence 999999999999999998643 47999999999873
No 13
>PF08699 DUF1785: Domain of unknown function (DUF1785); InterPro: IPR014811 This region is found in argonaute [] proteins and often co-occurs with IPR003103 from INTERPRO and IPR003165 from INTERPRO. ; PDB: 1R6Z_P 3MJ0_A 4EI1_A 4F3T_A 4EI3_A 1R4K_A.
Probab=99.49 E-value=9.7e-15 Score=118.31 Aligned_cols=52 Identities=62% Similarity=1.081 Sum_probs=42.2
Q ss_pred ccccccccCCCCCCcccCCCCeEEeecceeeeeccCCeeeeeeecccceeecC
Q 001599 355 CPVGRSFYSPDLGRRQPLGEGLESWRGFYQSIRPTQMGLSLNIDMSSTAFIEP 407 (1047)
Q Consensus 355 ~~~Gr~ff~~~~~~~~~l~~Gle~~~G~~~Svr~~~~~l~LniD~s~~~F~~~ 407 (1047)
+.+||+||+++... .+|++|+|+|+||||||||++++|+||||+++++||++
T Consensus 1 ~~vgrsFF~~~~~~-~~l~~Gle~~rG~~qSvRp~~~~l~lNvDvs~~aF~~p 52 (52)
T PF08699_consen 1 TAVGRSFFPPSGGP-VDLGGGLEAWRGFFQSVRPTQGGLLLNVDVSHTAFYKP 52 (52)
T ss_dssp EEETTEEEE-------EEETTEEEEEEEEEEEEEETTEEEEEEECCEECCC--
T ss_pred CccccccCCCCCCC-ccCCCcEEEeEeEEeeeEEcCCCCEEEEeCceeeEECc
Confidence 36899999877443 78999999999999999999999999999999999985
No 14
>cd02844 PAZ_CAF_like PAZ domain, CAF_like subfamily. CAF (for carpel factory) is a plant homolog of Dicer. CAF has been implicated in flower morphogenesis and in early Arabidopsis development and might function through posttranscriptional regulation of specific mRNA molecules. PAZ domains are named after the proteins Piwi, Argonaut, and Zwille. PAZ is found in two families of proteins that are essential components of RNA-mediated gene-silencing pathways, including RNA interference, the Piwi and Dicer families. PAZ functions as a nucleic-acid binding domain, with a strong preference for single-stranded nucleic acids (RNA or DNA) or RNA duplexes with single-stranded 3' overhangs. It has been suggested that the PAZ domain provides a unique mode for the recognition of the two 3'-terminal nucleotides in single-stranded nucleic acids and buries the 3' OH group, and that it might recognize characteristic 3' overhangs in siRNAs within RISC (RNA-induced silencing) and other complexes.
Probab=99.40 E-value=2.6e-13 Score=132.74 Aligned_cols=84 Identities=31% Similarity=0.532 Sum_probs=71.0
Q ss_pred HHHHccceEEEEeecCCcCceEEEeccCCCCCcceeeeecCCCceeeHHHHHHHHcCCccCCCCCcEEEecc--------
Q 001599 435 IKKALRGVRVEVTHRGNMRRKYRISGLTSQTTGELTFPVDESGTLKSVVEYFYETYGFVIQHTQWPCLQVGN-------- 506 (1047)
Q Consensus 435 l~~~L~gl~V~~~~~~~~~r~~~I~~i~~~~a~~~~F~~~~~g~~isV~~Yf~~~Y~i~L~~p~lP~v~~g~-------- 506 (1047)
..+.|+|++|.++|+ ++.|+|.+|+ +.+++.+|+.++.++.+|++|||+++|||+|+||+||||++..
T Consensus 27 ~~~~l~g~~V~t~hn---~r~Y~I~~i~-~~~p~s~F~~~~~~~~~Sy~eYy~~kY~i~L~~~~QPLL~~~~~~~~~NlL 102 (135)
T cd02844 27 CACDLKGSVVTAPHN---GRFYVISGIL-DLNANSSFPGKEGLGYATYAEYFKEKYGIVLNHPNQPLLKGKQIFNLHNLL 102 (135)
T ss_pred cHHHhcCCEEEEcCC---CcEEEEEEEc-CCCccCcccCCCCCceeeHHHHHHHHhCceeccCCcceEEEecccccceec
Confidence 467899999999997 7899999999 8889999986553367999999999999999999999999751
Q ss_pred ------------CCC---CccccccceEecC
Q 001599 507 ------------QQR---PNYLPMEVCKIVE 522 (1047)
Q Consensus 507 ------------~~~---~~ylP~Elc~i~~ 522 (1047)
+.+ .++||||||.+.+
T Consensus 103 ~~~~~~~~~~~~~~~~~~~v~L~PELC~~~~ 133 (135)
T cd02844 103 HNRFEEKGESEEKEKDRYFVELPPELCSVID 133 (135)
T ss_pred ccccccccccccccccceEEEeChHHhcccc
Confidence 011 3689999998763
No 15
>PF12764 Gly-rich_Ago1: Glycine-rich region of argonaut; InterPro: IPR024357 This domain is found in the N terminus of some argonaut proteins. Argonaut (AGO) proteins are involved in RNA-mediated post-transcriptional gene silencing [].
Probab=99.26 E-value=1.9e-11 Score=108.81 Aligned_cols=98 Identities=63% Similarity=1.015 Sum_probs=67.4
Q ss_pred CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCcccccCCCCCCCCCCCCCCccccCCCCCCCCCc
Q 001599 88 SEYQGRGRGGPPQPGGRGGYGGGRGGVGMGSGGRGGHSGGPTRSSQIPELHQATPTPFSSGVMTQPTQSQAGSSSHSPEL 167 (1047)
Q Consensus 88 ~~~~g~g~g~~~~~gg~g~~~gg~gg~g~~~~~~gg~~~~~~~~~~~~~~~~a~~~~~~~~~~~~~~~~~~~~~~~~~~~ 167 (1047)
..|+++|+|++...||.++|+||++|+ +...++++++.+|++|||++++|+|+.++++++.++++++++++.
T Consensus 4 ~eYqgrGRGgp~~qgG~~~yGggrgg~--------~ps~G~p~r~~~PELHQAt~~~yQa~v~~qp~pSea~sss~p~e~ 75 (104)
T PF12764_consen 4 PEYQGRGRGGPPQQGGRPGYGGGRGGG--------GPSGGGPPRPSVPELHQATQVQYQAPVSSQPSPSEASSSSQPPEP 75 (104)
T ss_pred ccccccCCCCCcccCCCCCCCCCCCCC--------CCCCCCCcCCCcchhhcccCCcccCcccCCCCcCcCCCccCCCCc
Confidence 345566666555445555553332211 122235566688999999999999999978888888888888444
Q ss_pred h--hhhHHhhccCCCcccCcCCcCCCCC
Q 001599 168 S--EVSQQFQQLSLPEEVSSSQVIQPAP 193 (1047)
Q Consensus 168 ~--~~~~~~~~~~~~~~~s~~~~~~~~p 193 (1047)
. .++++|++|.+..++++.+++.+.|
T Consensus 76 s~~qv~QQfqqLsi~~e~s~sQaiQp~P 103 (104)
T PF12764_consen 76 STVQVTQQFQQLSIQQESSPSQAIQPAP 103 (104)
T ss_pred chHHHHHHHHHHhhccCCCcccccCCCC
Confidence 4 3799999999988777777776544
No 16
>COG1431 Argonaute homolog, implicated in RNA metabolism [Translation, ribosomal structure and biogenesis]
Probab=99.24 E-value=1.4e-10 Score=132.28 Aligned_cols=303 Identities=17% Similarity=0.140 Sum_probs=183.9
Q ss_pred hHHHHHHHHHHHHHHHhcC-cccCC-CCcccCCCCCchhHHHHHHHHHHHHHhhhcCCCCceEEEEEeeCCCCchhhhhh
Q 001599 637 DSIARGFCFELAQMCYISG-MAFNP-EPVIPPISARPEHVEKVLKTRYHDAMTKLGQGKELDLLIVILPDNNGSLYGDLK 714 (1047)
Q Consensus 637 ~~~~~~f~~~l~~~~~~~G-m~i~~-~p~~~~~~~~~~~~~~~l~~~~~~~~~~~~~~~~~~lvlvilp~~~~~~Y~~IK 714 (1047)
...++.|.+.+..+.+..+ +...- -+-+.....++.. ...|..+++++ ....++..-+-++...|+.+|
T Consensus 355 ~~rlk~~~kkv~~~fkn~n~i~~k~eg~~l~~a~~r~~~-kddl~~iIkei--------d~ee~~k~e~ykdd~~YailK 425 (685)
T COG1431 355 LTRLKSTIKKVVYGFKNSNGIDWKVEGLTLHVAGKRPKM-KDDLTKIIKEI--------DVEELKKQEMYKDDVKYAILK 425 (685)
T ss_pred hhHHHHHHHHHHHHHHhccchhhhcccceeeecccchhh-hccchhhhhhh--------hhhhhccccccccchHHHHHH
Confidence 3457888999999888776 43321 1222222222221 12333444332 012233444556678899999
Q ss_pred HhhhcccCceeEeEeecccccccHHHHHHHHHHHHHhcCccccccccccccCCCCcCCCCeEEEeeeecCCCCCCCCCCc
Q 001599 715 RICETDLGLVSQCCLTKHVFKMSKQYMANVALKINVKVGGRNTVLVDAISRRIPLVSDRPTIIFGADVTHPHPGEDSSPS 794 (1047)
Q Consensus 715 ~~~d~~~GI~TQcv~~~~~~k~~~q~~~Nv~lKiN~KlGG~N~~l~~~~~~~~p~~~~~~tmiiG~DVtHp~~g~~~~pS 794 (1047)
+ .+.-|++|.++..+..|.-.-++.|+|+|+-+|-+|+.+.+.+. ...-+-|+|+||+.-+-+. -.
T Consensus 426 r---ld~~ipsqvil~~n~rk~~Kg~~tnla~~~~~ktlgqpY~~r~~--------~gpvDaivGlDvsr~~~gn---~t 491 (685)
T COG1431 426 R---LDETIPSQVILDPNNRKPYKGTKTNLASKRYLKTLGQPYLKRNG--------LGPVDAIVGLDVSRVSEGN---WT 491 (685)
T ss_pred h---hcccCcceeeeccccCCcchhhhhHHHHHHHHHhcCCceeeecc--------CCCccceeeeeeeEEeeCC---eE
Confidence 8 44569999999999888778899999999999999999977542 1223579999999876432 23
Q ss_pred EEEEEEecCC-CCccceEEEEEee-cCchhHHHHHHH-H----hcCCCCcEEecCCCChhhHHHHHHHHHHHHHHHHHhh
Q 001599 795 IAAVVASQDW-PEVTKYAGLVCAQ-AHRQELIQDLFK-T----WQDPGTPYIFPDGVSEGQFYQVLLYELDAIRKACASL 867 (1047)
Q Consensus 795 iaavVaS~D~-~~~~ky~~~~~~Q-~~r~EiI~~l~~-~----~~~~~~PIiyRDGVSEgQf~~Vl~~El~~Ik~A~~~l 867 (1047)
+-|++.-.|. ..+-.|.-....- ..|-|-+-+.++ | ++..++|++.|||- +...|+.++++.=.++
T Consensus 492 V~gct~~f~seg~l~eyy~t~tpa~GErl~~~g~yle~~~~~gfe~~n~iV~lRDG~-------l~~~E~aavkeyg~el 564 (685)
T COG1431 492 VEGCTSCFVSEGGLEEYYHTVTPALGERLETSGRYLEKMNWRGFESRNLIVTLRDGK-------LVAGEIAAVKEYGGEL 564 (685)
T ss_pred EeeeeEEEeccCceEEeeecccCCccchhhhHHHHHHHHHhhhhhccCeeEEEecCc-------cchHHHHHHHHHhhhc
Confidence 4343322230 2333333221111 112233333222 2 45566789999995 6678988888766555
Q ss_pred CCCCCCCEEEEEEeecccccccccCCCCCCcCCCCCCCcCceeccCcccCCCcccEEeeeccCCcccccCCeEEEEecCC
Q 001599 868 EPNYQPPVTFVVVQKRHHTRLFANNHHDRNAVDRSGNILPGTVVDSKICHPTEFDFYLCSHAGIQGTSRPAHYHVLWDEN 947 (1047)
Q Consensus 868 ~~~~~P~iT~Ivv~KRHhtRff~~~~~~~~~~~~~~N~~pGTVVD~~It~p~~~DFyL~Sh~~~qGTsrPthY~VL~De~ 947 (1047)
. -.++++.+-|. +-+||..+..-. +-..| =|--.++.+|+|.. ....||-+|..--= -|-
T Consensus 565 g----sn~ev~~i~kn-Np~vf~~e~~i~---g~f~~--~~~s~~h~~~~~yn--------pv~~gT~~pi~~r~--~~g 624 (685)
T COG1431 565 G----SNPEVNRILKN-NPWVFAIEGEIW---GAFVR--LDGSTVHLCCSPYN--------PVRRGTPRPIALRR--RDG 624 (685)
T ss_pred C----CChhhheeccc-CCeEEEecceee---eEEEe--cCCcccccccCCCC--------ceecCCCccccccc--ccC
Confidence 2 45566666554 555998765310 00111 11112334444422 34568888865432 222
Q ss_pred CCCHHHHHHHHHHhhcccccccCc--cccCcHHHHHHHHHHHHhh
Q 001599 948 KFTADGLQSLTNNLCYTYARCTRS--VSIVPPAYYAHLAAFRARF 990 (1047)
Q Consensus 948 ~~~~d~Lq~LT~~LCy~y~r~t~s--VSip~P~yYA~l~a~Rar~ 990 (1047)
.+.-|-|- |.|+|+-|.+-+... .+||||++|||++.+-+|.
T Consensus 625 ~l~~e~i~-lv~dLT~mNys~~~g~~~rlPApvhYaDk~~kl~~~ 668 (685)
T COG1431 625 KLDGELIG-LVHDLTAMNYSNPSGTWSRLPAPVHYADKASKLARY 668 (685)
T ss_pred ccchhhHH-HHHHhhhhccCCCCCceecCCcchhhhHHHHHHHhc
Confidence 34445555 999999998888887 9999999999999999886
No 17
>cd02843 PAZ_dicer_like PAZ domain, dicer_like subfamily. Dicer is an RNAse involved in cleaving dsRNA in the RNA interference pathway. It generates dsRNAs which are approximately 20 bp long (siRNAs), which in turn target hydrolysis of homologous RNAs. PAZ domains are named after the proteins Piwi Argonaut and Zwille. PAZ is found in two families of proteins that are essential components of RNA-mediated gene-silencing pathways, including RNA interference, the piwi and Dicer families. PAZ functions as a nucleic-acid binding domain, with a strong preference for single-stranded nucleic acids (RNA or DNA) or RNA duplexes with single-stranded 3' overhangs. It has been suggested that the PAZ domain provides a unique mode for the recognition of the two 3'-terminal nucleotides in single-stranded nucleic acids and buries the 3' OH group, and that it might recognize characteristic 3' overhangs in siRNAs within RISC (RNA-induced silencing) and other complexes.
Probab=98.42 E-value=3.3e-07 Score=86.87 Aligned_cols=67 Identities=18% Similarity=0.241 Sum_probs=58.5
Q ss_pred HHccceEEEEeecCCc-CceEEEeccCCCCCcceeeeecCCCceeeHHHHHHHHcCCccCCCCCcEEEecc
Q 001599 437 KALRGVRVEVTHRGNM-RRKYRISGLTSQTTGELTFPVDESGTLKSVVEYFYETYGFVIQHTQWPCLQVGN 506 (1047)
Q Consensus 437 ~~L~gl~V~~~~~~~~-~r~~~I~~i~~~~a~~~~F~~~~~g~~isV~~Yf~~~Y~i~L~~p~lP~v~~g~ 506 (1047)
+.+.|..|.+.|++.. .++|+|.+|.+..++..+|+.+ + .+|++|||+++|||.|++++||+|.|..
T Consensus 39 ~~~~g~vV~t~YnN~d~pK~Y~V~dI~~dltP~S~F~~~--~-~~Ty~eYyk~KY~I~I~~~~QPLL~v~~ 106 (122)
T cd02843 39 EDYQDAVVMPWYRNFDQPQYFYVAEICTDLRPLSKFPGP--E-YETFEEYYKKKYKLDIQNLNQPLLDVDH 106 (122)
T ss_pred HHhCCCEEeecccCCCCCeEEEEEEEcCCCCCCCCCCCC--C-CccHHHHHHHhcCeEeccCCCCcEeecC
Confidence 5688999999998532 3899999999999999999743 3 7999999999999999999999999964
No 18
>KOG1596 consensus Fibrillarin and related nucleolar RNA-binding proteins [RNA processing and modification]
Probab=94.08 E-value=0.21 Score=53.00 Aligned_cols=6 Identities=17% Similarity=0.296 Sum_probs=2.7
Q ss_pred EEEEEE
Q 001599 307 EFKVVI 312 (1047)
Q Consensus 307 ~~~V~i 312 (1047)
.|-|++
T Consensus 184 VYAVEf 189 (317)
T KOG1596|consen 184 VYAVEF 189 (317)
T ss_pred EEEEEe
Confidence 444444
No 19
>PF12764 Gly-rich_Ago1: Glycine-rich region of argonaut; InterPro: IPR024357 This domain is found in the N terminus of some argonaut proteins. Argonaut (AGO) proteins are involved in RNA-mediated post-transcriptional gene silencing [].
Probab=89.82 E-value=0.4 Score=43.91 Aligned_cols=46 Identities=15% Similarity=0.185 Sum_probs=27.7
Q ss_pred CCCCCCCCCcccccC----CCCCCCCCCCCCCccccCCCCCCCCCchhhh
Q 001599 126 GGPTRSSQIPELHQA----TPTPFSSGVMTQPTQSQAGSSSHSPELSEVS 171 (1047)
Q Consensus 126 ~~~~~~~~~~~~~~a----~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 171 (1047)
..+..++++..+||| .+.|..+.++..++++.+..++++.+..++.
T Consensus 41 ~~PELHQAt~~~yQa~v~~qp~pSea~sss~p~e~s~~qv~QQfqqLsi~ 90 (104)
T PF12764_consen 41 SVPELHQATQVQYQAPVSSQPSPSEASSSSQPPEPSTVQVTQQFQQLSIQ 90 (104)
T ss_pred CcchhhcccCCcccCcccCCCCcCcCCCccCCCCcchHHHHHHHHHHhhc
Confidence 447888888888998 3445555555455444544445664444443
No 20
>COG4371 Predicted membrane protein [Function unknown]
Probab=86.97 E-value=1.1 Score=47.55 Aligned_cols=16 Identities=19% Similarity=0.395 Sum_probs=9.0
Q ss_pred CCchhhhHHhhccCCC
Q 001599 165 PELSEVSQQFQQLSLP 180 (1047)
Q Consensus 165 ~~~~~~~~~~~~~~~~ 180 (1047)
+++-++..++++++.+
T Consensus 155 A~a~elk~eL~~iA~~ 170 (334)
T COG4371 155 AEADELKSELQRIAQQ 170 (334)
T ss_pred hhhHHHHHHHHHHHHh
Confidence 4455566666666544
No 21
>PF13032 DUF3893: Domain of unknown function (DUF3893)
Probab=86.55 E-value=1.2 Score=44.22 Aligned_cols=56 Identities=18% Similarity=0.164 Sum_probs=45.9
Q ss_pred ccCCeEEEEecCCCCCHHHHHHHHHHhhcccccccCccccCcHHHHHHHHHHHHhhhcCC
Q 001599 935 SRPAHYHVLWDENKFTADGLQSLTNNLCYTYARCTRSVSIVPPAYYAHLAAFRARFYMEP 994 (1047)
Q Consensus 935 srPthY~VL~De~~~~~d~Lq~LT~~LCy~y~r~t~sVSip~P~yYA~l~a~Rar~~~~~ 994 (1047)
....=.+|+.=...-.+++|-.|||.||+.+.-.-..+.+|-|+++|.+ ++.|+-+
T Consensus 67 ~~ilEI~V~~~~~~d~~~~lA~~vh~LR~~~~~~~~~l~lP~PLHlak~----~~eYi~~ 122 (138)
T PF13032_consen 67 PQILEITVLGCQPEDDPEALAKLVHYLRRSPPLYDENLALPLPLHLAKQ----AKEYILP 122 (138)
T ss_pred CCceEEEEeccCCCCCHHHHHHHHHHHHhCcccccccccCcccHHHHHH----HHHHccc
Confidence 4445567776655678999999999999999999999999999999887 4567665
No 22
>smart00157 PRP Major prion protein. The prion protein is a major component of scrapie-associated fibrils in Creutzfeldt-Jakob disease, kuru, Gerstmann-Straussler syndrome and bovine spongiform encephalopathy.
Probab=84.11 E-value=5.3 Score=40.84 Aligned_cols=11 Identities=27% Similarity=0.283 Sum_probs=6.5
Q ss_pred CCceeeeEEEE
Q 001599 227 DKDLHQYDVTI 237 (1047)
Q Consensus 227 ~~~iy~YdV~i 237 (1047)
+.+|-+|.|+-
T Consensus 158 N~tv~~~~~~~ 168 (217)
T smart00157 158 NITIKQHTVTT 168 (217)
T ss_pred hhheeeeEecc
Confidence 44566776654
No 23
>PRK11617 endonuclease V; Provisional
Probab=83.13 E-value=31 Score=37.20 Aligned_cols=39 Identities=13% Similarity=0.183 Sum_probs=31.3
Q ss_pred CCCCHHHHHHHHHHhhcccccccCccccCcHHHHHHHHHHHHhhhc
Q 001599 947 NKFTADGLQSLTNNLCYTYARCTRSVSIVPPAYYAHLAAFRARFYM 992 (1047)
Q Consensus 947 ~~~~~d~Lq~LT~~LCy~y~r~t~sVSip~P~yYA~l~a~Rar~~~ 992 (1047)
+..+.|+--.++-.+|= -=++|.|+..||++|.+.+...
T Consensus 179 h~i~l~~A~~~v~~~~~-------~yRlPePlR~Ad~ls~~~~~~~ 217 (224)
T PRK11617 179 HRVSLDSALAWVQRCMK-------GYRLPEPTRWADALASRRPAFV 217 (224)
T ss_pred CCcCHHHHHHHHHHHcc-------CCCCCHHHHHHHHHHhhhhhhh
Confidence 45788888899988872 2379999999999998887643
No 24
>KOG4307 consensus RNA binding protein RBM12/SWAN [General function prediction only]
Probab=80.54 E-value=19 Score=43.94 Aligned_cols=12 Identities=17% Similarity=0.445 Sum_probs=8.5
Q ss_pred eEEeeeEEeecC
Q 001599 215 IVKANHFFAELP 226 (1047)
Q Consensus 215 ~l~aN~f~v~~~ 226 (1047)
.|.+|-|+.++.
T Consensus 869 V~~~~n~Pf~v~ 880 (944)
T KOG4307|consen 869 VLSCNNFPFDVT 880 (944)
T ss_pred EEEecCCCcccc
Confidence 677888876654
No 25
>cd06559 Endonuclease_V Endonuclease_V, a DNA repair enzyme that initiates repair of nitrosative deaminated purine bases. Endonuclease_V (EndoV) is an enzyme that can initiate repair of all possible deaminated DNA bases. EndoV cleaves the DNA strand containing lesions at the second phosphodiester bond 3' to the lesion using Mg2+ as a cofactor. EndoV homologs are conserved throughout all domains of life from bacteria to humans. EndoV is encoded by the nfi gene and nfi null mutant mice have a phenotype prone to cancer. The ability of endonuclease V to recognize mismatches and abnormal replicative DNA structures suggests that the enzyme plays an important role in DNA metabolism. The details of downstream processing for the EndoV pathway remain unknown.
Probab=77.47 E-value=61 Score=34.64 Aligned_cols=172 Identities=18% Similarity=0.236 Sum_probs=88.6
Q ss_pred CCCeEEEeeeecCCCCCCCCCCcEEEEEEecCCCCccceEEEEEeecCchhHHHHHHHHhcCCCCcEEecCCCChhhHHH
Q 001599 772 DRPTIIFGADVTHPHPGEDSSPSIAAVVASQDWPEVTKYAGLVCAQAHRQELIQDLFKTWQDPGTPYIFPDGVSEGQFYQ 851 (1047)
Q Consensus 772 ~~~tmiiG~DVtHp~~g~~~~pSiaavVaS~D~~~~~ky~~~~~~Q~~r~EiI~~l~~~~~~~~~PIiyRDGVSEgQf~~ 851 (1047)
..+.+|-|+||+|... ..-.+|++|. ++|++..-....++.-.-.. | |=-| .
T Consensus 23 ~~~~~I~gvDiS~~~~---~~~~vaa~Vv-~~~~~~~~~~~~~~~~~~~~---------------P--YIPG----~--- 74 (208)
T cd06559 23 GEVRLVAGVDVSYKKD---GDLAVAAAVV-LDYPDLEVVETAVAVGEVTF---------------P--YIPG----L--- 74 (208)
T ss_pred CCccEEEEEEeeeccC---CCeEEEEEEE-EECCCCcEEEEEEEEEecCC---------------C--Ccch----h---
Confidence 4678999999999752 2335666554 46655554444433222111 1 1122 1
Q ss_pred HHHHHHHHHHHHHHhhCCCCCCCEEEEEEeecccccccccCCC-----CCCcCCCCCCCcCceeccCcccCCCcccEEee
Q 001599 852 VLLYELDAIRKACASLEPNYQPPVTFVVVQKRHHTRLFANNHH-----DRNAVDRSGNILPGTVVDSKICHPTEFDFYLC 926 (1047)
Q Consensus 852 Vl~~El~~Ik~A~~~l~~~~~P~iT~Ivv~KRHhtRff~~~~~-----~~~~~~~~~N~~pGTVVD~~It~p~~~DFyL~ 926 (1047)
..-.|++.|.++++++. -.|.+.+|==+=.-|-|.|=---. +....+-..|..-|+..+..-. .-++-..
T Consensus 75 LafRE~p~l~~~~~~l~--~~PDlilVDG~G~~HpR~~GlA~HlGv~l~~PtIGVAK~~l~g~~~~~~~~---~g~~~~~ 149 (208)
T cd06559 75 LAFREGPPLLEALEKLK--TKPDLLLVDGHGIAHPRRFGLASHLGVLLDLPTIGVAKSLLVGDGEEPGEE---RGSFTPL 149 (208)
T ss_pred HHHhhHHHHHHHHHhCC--CCCCEEEEeCCccccCCCcchhheeeeecCCCEEEEEccccccCCcCcccc---cCceeee
Confidence 23468888888888874 257776665555555665532110 0000111123444444433210 0111111
Q ss_pred ecc-CCccc-------ccCCeEEEEecCCCCCHHHHHHHHHHhhcccccccCccccCcHHHHHHHHHH
Q 001599 927 SHA-GIQGT-------SRPAHYHVLWDENKFTADGLQSLTNNLCYTYARCTRSVSIVPPAYYAHLAAF 986 (1047)
Q Consensus 927 Sh~-~~qGT-------srPthY~VL~De~~~~~d~Lq~LT~~LCy~y~r~t~sVSip~P~yYA~l~a~ 986 (1047)
.+. -..|. .+|.-. -=-+..+.|+--+++-.+| +.-++|.|+..||+++.
T Consensus 150 ~~~~~~vG~~~r~~~~~~PiyV---S~Gh~i~l~~A~~~v~~~~-------~~~r~Pep~R~Ad~~sr 207 (208)
T cd06559 150 YDDGEVVGAALRTRDGVKPVYV---SPGHRIDLETAVELVLKCC-------KGYRLPEPTRLADLLSR 207 (208)
T ss_pred ccCCEEEEEEEecCCCCCCEEE---cCCCCcCHHHHHHHHHHHc-------cCCCCCcHHHHHHHHhc
Confidence 111 11111 233222 2224578888888888876 44679999999999874
No 26
>PF05642 Sporozoite_P67: Sporozoite P67 surface antigen; InterPro: IPR008845 This family consists of several Theileria P67 surface antigens. A stage specific surface antigen of Theileria parva, p67, is the basis for the development of an anti-sporozoite vaccine for the control of East Coast fever (ECF) in Bos taurus. The antigen has been shown to contain five distinct linear peptide sequences recognised by sporozoite-neutralising murine monoclonal antibodies [].
Probab=58.57 E-value=2.5e+02 Score=34.13 Aligned_cols=20 Identities=20% Similarity=0.469 Sum_probs=13.2
Q ss_pred cCCHHHHHHHHHhhcCCchH
Q 001599 529 RLNERQITALLKVTCQRPHE 548 (1047)
Q Consensus 529 kl~~~q~~~mik~a~~~P~~ 548 (1047)
.|++++...++..-...|.+
T Consensus 587 dlteeev~kilde~vkd~s~ 606 (727)
T PF05642_consen 587 DLTEEEVKKILDELVKDPSD 606 (727)
T ss_pred ccCHHHHHHHHHHHhcCcch
Confidence 56777777766666666655
No 27
>KOG3915 consensus Transcription regulator dachshund, contains SKI/SNO domain [Transcription]
Probab=52.17 E-value=59 Score=37.95 Aligned_cols=12 Identities=25% Similarity=0.431 Sum_probs=5.7
Q ss_pred CccccccceEec
Q 001599 510 PNYLPMEVCKIV 521 (1047)
Q Consensus 510 ~~ylP~Elc~i~ 521 (1047)
++.+|+.-....
T Consensus 371 pvslppasv~ma 382 (641)
T KOG3915|consen 371 PVSLPPASVEMA 382 (641)
T ss_pred cccCCchhhHHH
Confidence 455555444333
No 28
>COG1515 Nfi Deoxyinosine 3'endonuclease (endonuclease V) [DNA replication, recombination, and repair]
Probab=51.01 E-value=2.3e+02 Score=30.25 Aligned_cols=123 Identities=20% Similarity=0.179 Sum_probs=61.4
Q ss_pred HHHHHHHHHHHhhCCCCCCCEEEEEEeecccccccccCCC-----CCCcCCCCCCCcCceeccCcccCCCcccEEeeecc
Q 001599 855 YELDAIRKACASLEPNYQPPVTFVVVQKRHHTRLFANNHH-----DRNAVDRSGNILPGTVVDSKICHPTEFDFYLCSHA 929 (1047)
Q Consensus 855 ~El~~Ik~A~~~l~~~~~P~iT~Ivv~KRHhtRff~~~~~-----~~~~~~~~~N~~pGTVVD~~It~p~~~DFyL~Sh~ 929 (1047)
.|++.+-+|++.+.. +|.+.+|==+=.-|-|.+=--.. +....+--.+..-||.++ .......+ =+|.-|-
T Consensus 80 RE~p~~l~a~~~l~~--~~d~ilVDG~GiaHPR~~GlAsH~Gv~l~~PtIGVAK~~L~gt~~~-~~~~~g~~-~~l~~~g 155 (212)
T COG1515 80 RELPLLLKALEKLSV--KPDLLLVDGHGIAHPRRLGLASHIGVLLDVPTIGVAKSRLCGTPVE-PESRRGAG-KPLYDKG 155 (212)
T ss_pred hhhHHHHHHHHhcCC--CCCEEEEcCcceecCcccChhheeeeeeCCCceeEehhhhcCcccC-cccccCcc-eeEecCC
Confidence 378888888888853 35554443333344444421110 000001112345566666 11000000 0111110
Q ss_pred ----CCcccccCCeEEEEecCCCCCHHHHHHHHHHhhcccccccCccccCcHHHHHHHHHHHH
Q 001599 930 ----GIQGTSRPAHYHVLWDENKFTADGLQSLTNNLCYTYARCTRSVSIVPPAYYAHLAAFRA 988 (1047)
Q Consensus 930 ----~~qGTsrPthY~VL~De~~~~~d~Lq~LT~~LCy~y~r~t~sVSip~P~yYA~l~a~Ra 988 (1047)
..-.|.+.+.=.++-=.+..+.++.-+|+.+|| +..++|.|+-.||+.+.+.
T Consensus 156 ev~g~~l~t~~~~~pi~vS~g~~i~l~sal~l~~~l~-------~~~rlpeptr~ad~~a~~~ 211 (212)
T COG1515 156 EVLGGVLRTKERAKPIFVSPGHRISLPSALKLAQRLS-------KGYRLPEPTRLADILAKKR 211 (212)
T ss_pred eEEEEEEEecccCCCeEEccCCccCHHHHHHHHHHHc-------ccccCCCcccHHHHhhhhc
Confidence 112344333333333334568888889998887 4478999999999998764
No 29
>PF04493 Endonuclease_5: Endonuclease V; InterPro: IPR007581 Endonuclease V is specific for single-stranded DNA, for duplex DNA that contains uracil, or that is damaged []. Matrix metalloproteinase-1 (MMP-1) is the major enzyme responsible for collagen 1 digestion. It is induced by exposure to sunlight, but is reduced with treatment of DNA repair enzyme endonuclease V []. This family consequently has potential medical importance []. This endonuclease also appears in bifunctional enzymes, such as the bifunctional methyltransferase/endonuclease in Thermoplasma acidophilum.; GO: 0004519 endonuclease activity, 0006281 DNA repair; PDB: 3GA2_A 2W36_A 3HD0_A 2W35_B 3GOC_B.
Probab=48.14 E-value=75 Score=33.91 Aligned_cols=31 Identities=16% Similarity=0.367 Sum_probs=23.6
Q ss_pred CCCHHHHHHHHHHhhcccccccCc-cccCcHHHHHHHHH
Q 001599 948 KFTADGLQSLTNNLCYTYARCTRS-VSIVPPAYYAHLAA 985 (1047)
Q Consensus 948 ~~~~d~Lq~LT~~LCy~y~r~t~s-VSip~P~yYA~l~a 985 (1047)
..+.+..-+++..+| +. -++|-|++.||+..
T Consensus 175 ~i~l~ta~~iv~~~~-------~~~~r~PeP~r~Ad~~t 206 (206)
T PF04493_consen 175 RISLETALEIVLKLC-------KGGYRLPEPTRLADLLT 206 (206)
T ss_dssp SS-HHHHHHHHHHTS-------STTSSS-HHHHHHHHHH
T ss_pred CcCHHHHHHHHHHHc-------CCCCcCCCcchhhhhcC
Confidence 458888888888887 44 78999999999863
No 30
>KOG3915 consensus Transcription regulator dachshund, contains SKI/SNO domain [Transcription]
Probab=41.73 E-value=1.1e+02 Score=35.92 Aligned_cols=11 Identities=9% Similarity=0.386 Sum_probs=4.9
Q ss_pred cCCCceeeeEE
Q 001599 225 LPDKDLHQYDV 235 (1047)
Q Consensus 225 ~~~~~iy~YdV 235 (1047)
+-...+--|+|
T Consensus 182 ~rG~kVAsF~i 192 (641)
T KOG3915|consen 182 LRGAKVASFTI 192 (641)
T ss_pred ecCceeeEEEe
Confidence 33344444444
No 31
>PF01949 DUF99: Protein of unknown function DUF99; InterPro: IPR002802 The function of the archaebacterial proteins in this family is unknown.; PDB: 2QH9_A.
Probab=37.41 E-value=91 Score=32.77 Aligned_cols=163 Identities=18% Similarity=0.240 Sum_probs=75.4
Q ss_pred eEEEeeeecCCCCCCCCCCcEEEEEEecCCCCccceEEE--EEeecCchhHHHHHHHHhcCCCCc---EEecCCCChhhH
Q 001599 775 TIIFGADVTHPHPGEDSSPSIAAVVASQDWPEVTKYAGL--VCAQAHRQELIQDLFKTWQDPGTP---YIFPDGVSEGQF 849 (1047)
Q Consensus 775 tmiiG~DVtHp~~g~~~~pSiaavVaS~D~~~~~ky~~~--~~~Q~~r~EiI~~l~~~~~~~~~P---IiyRDGVSEgQf 849 (1047)
.-|+|+|=+.-..+ +..-.++++|..-| ...-+. -++...+...-+.+.+|++...+| +|+=|||.=+=|
T Consensus 4 iRvlGidDs~f~~~-~~~s~lvGvv~r~~----~~idGv~~~~itvdG~DaT~~i~~m~~~~~r~~i~~v~LdGit~agF 78 (187)
T PF01949_consen 4 IRVLGIDDSPFPRS-DGKSVLVGVVMRGD----RRIDGVAFGRITVDGMDATEAIIEMVKRLFRPDIRVVMLDGITFAGF 78 (187)
T ss_dssp SEEEEEEEEE-SS-----EEEEEEEEETT-----EEEEEEEEEE-TT-S-HHHHHHHHHCCTTTTTEEEEEESSSEETTT
T ss_pred cEEEEEecCCCccC-CCceEEEEEEEeCC----eEEEEEEEEEEEECCchHHHHHHHHHHhcccCcceEEEECCEeEEee
Confidence 34788886654332 11123455555433 111112 223344455555567777765555 899999999988
Q ss_pred HHHHHHHHHHHHHHHHhhCCCCCCCEEEEEEeecccc--cc-------cccCCCCCC-cCCCCCCCcCceeccCcccCCC
Q 001599 850 YQVLLYELDAIRKACASLEPNYQPPVTFVVVQKRHHT--RL-------FANNHHDRN-AVDRSGNILPGTVVDSKICHPT 919 (1047)
Q Consensus 850 ~~Vl~~El~~Ik~A~~~l~~~~~P~iT~Ivv~KRHht--Rf-------f~~~~~~~~-~~~~~~N~~pGTVVD~~It~p~ 919 (1047)
.-| .+.+-++++ .+=+|+|..+-.. ++ ||.... +- ...+.+|+.+ +..+.
T Consensus 79 Nii------D~~~l~~~t------g~PVI~V~~~~p~~~~i~~AL~~hF~d~~~-R~~~i~~~g~~~~-------v~~~~ 138 (187)
T PF01949_consen 79 NII------DIERLYEET------GLPVIVVMRKEPNLEGIESALRKHFPDWEE-RLEIIEKLGPREP-------VSTPT 138 (187)
T ss_dssp EE--------HHHHHHHH---------EEEEESS---HHHHHHCCTT-STTHHH-HHHHHHHC---EE-------E----
T ss_pred EEe------cHHHHHHHH------CCCEEEEEEeCCCHHHHHHHHHHhCCCHHH-HHHHHHhCCCcEE-------eeecc
Confidence 766 233333443 3345555544333 22 443210 00 0001122211 11122
Q ss_pred cccEEeeeccCCcccccCCeEEEEecCCCCCHHHHHHHHHHhhcccccccCccccCcHHHHHHHHHHHH
Q 001599 920 EFDFYLCSHAGIQGTSRPAHYHVLWDENKFTADGLQSLTNNLCYTYARCTRSVSIVPPAYYAHLAAFRA 988 (1047)
Q Consensus 920 ~~DFyL~Sh~~~qGTsrPthY~VL~De~~~~~d~Lq~LT~~LCy~y~r~t~sVSip~P~yYA~l~a~Ra 988 (1047)
...+|+++ .+++.++-.+|+..++ .-=++|-|+..||++|.-.
T Consensus 139 ~~~vyv~~-------------------~Gi~~~~A~~li~~~t-------~~g~iPEPLRvAhliA~~~ 181 (187)
T PF01949_consen 139 GGPVYVQS-------------------WGIDLEEARELIRRTT-------LHGKIPEPLRVAHLIASAI 181 (187)
T ss_dssp -TTEEEEE-------------------ESS-HHHHHHHHHHC--------SSSSS-HHHHHHHHHHHHH
T ss_pred cccEEEEE-------------------ecCCHHHHHHHHHHHh-------ccCCCcccHHHHHHHHHHh
Confidence 24444443 3678888888887765 2237999999999999544
No 32
>PF07555 NAGidase: beta-N-acetylglucosaminidase ; InterPro: IPR011496 This family consists of both eukaryotic and prokaryotic hyaluronidases. Human Q9HAR0 from SWISSPROT is expressed during meningioma []. Clostridium perfringens, P26831 from SWISSPROT, is involved in pathogenesis and is likely to act on connectivity tissue during gas gangrene []. It catalyses the random hydrolysis of 1->4-linkages between N-acetyl-beta-D-glucosamine and D-glucuronate residues in hyaluronate.; PDB: 2WB5_B 2V5C_B 2VUR_A 2V5D_A 2YDS_A 2CBI_A 2XPK_A 2CBJ_B 2J62_A 2X0Y_A ....
Probab=29.22 E-value=4.9e+02 Score=29.62 Aligned_cols=105 Identities=21% Similarity=0.183 Sum_probs=60.6
Q ss_pred HHHHHHHHhcCccc---CC--CCcccCCCCC--chhHHHHHHHHHHHHHhhhcCCCCceEEEEEeeCCCC-----chhhh
Q 001599 645 FELAQMCYISGMAF---NP--EPVIPPISAR--PEHVEKVLKTRYHDAMTKLGQGKELDLLIVILPDNNG-----SLYGD 712 (1047)
Q Consensus 645 ~~l~~~~~~~Gm~i---~~--~p~~~~~~~~--~~~~~~~l~~~~~~~~~~~~~~~~~~lvlvilp~~~~-----~~Y~~ 712 (1047)
..|.+++..+||+. .+ .|........ +++-.+.|+++.+.+.+ .++.|++.|-|..+- .-+..
T Consensus 18 ~~l~~f~~~~kmN~YiYAPKdDpyhr~~Wre~Yp~~el~~l~~L~~~a~~-----~~V~Fv~aisPg~~~~~s~~~d~~~ 92 (306)
T PF07555_consen 18 LDLIRFLGRYKMNTYIYAPKDDPYHRSKWREPYPEEELAELKELADAAKA-----NGVDFVYAISPGLDICYSSEEDFEA 92 (306)
T ss_dssp HHHHHHHHHTT--EEEE--TT-TTTTTTTTS---HHHHHHHHHHHHHHHH-----TT-EEEEEEBGTTT--TSHHHHHHH
T ss_pred HHHHHHHHHcCCceEEECCCCChHHHhhhcccCCHHHHHHHHHHHHHHHH-----cCCEEEEEECcccccccCcHHHHHH
Confidence 45677888899875 22 2443322111 44445667777776654 579999999998653 23556
Q ss_pred hhHhhhc--ccCceeEeEeecccc-----------cccHHHHHHHHHHHHHhcCc
Q 001599 713 LKRICET--DLGLVSQCCLTKHVF-----------KMSKQYMANVALKINVKVGG 754 (1047)
Q Consensus 713 IK~~~d~--~~GI~TQcv~~~~~~-----------k~~~q~~~Nv~lKiN~KlGG 754 (1047)
||...+. ++||-.=+|+.+-+. +...+--..|+..|+..|.-
T Consensus 93 L~~K~~ql~~lGvr~FailfDDi~~~~~~~~~~~~~~~~~~q~~l~n~v~~~l~~ 147 (306)
T PF07555_consen 93 LKAKFDQLYDLGVRSFAILFDDIDGDLWHCDKDDFNSLAQAQARLLNRVNKELIK 147 (306)
T ss_dssp HHHHHHHHHCTT--EEEEE-TS-SSC--TTTTTT-SCHHHHHHHHHHHHHHHTTT
T ss_pred HHHHHHHHHhcCCCEEEEeecCCCCccccccccccchHHHHHHHHHHHHHHHHhc
Confidence 6655553 579999999877665 22344556788888877763
No 33
>PLN03138 Protein TOC75; Provisional
Probab=27.16 E-value=46 Score=42.39 Aligned_cols=20 Identities=15% Similarity=0.257 Sum_probs=11.3
Q ss_pred CCccccccceE-ecCCccccc
Q 001599 509 RPNYLPMEVCK-IVEGQRYSK 528 (1047)
Q Consensus 509 ~~~ylP~Elc~-i~~gQ~~~~ 528 (1047)
++.++=-|+-. +.||+.+..
T Consensus 364 rD~VIRREL~~~lkeGd~fN~ 384 (796)
T PLN03138 364 QLPIIDRELPKQLRQGHIFNI 384 (796)
T ss_pred cCeEEeeecccccCCCcccCH
Confidence 44444456653 567777643
No 34
>PF05387 Chorion_3: Chorion family 3; InterPro: IPR008449 This family consists Drosophila chorion proteins S36 and S38, which are involved in chorion membrane formation. The proteins consist of a central domain and two flanking 'arms'. The central domain contains tandemly repetitive peptides, which apparently generate a secondary structure of beta-sheet strands alternating with beta-turns, most probably, forming a twisted beta-pleated sheet or beta-barrel [].
Probab=26.37 E-value=2.5e+02 Score=30.33 Aligned_cols=49 Identities=22% Similarity=0.213 Sum_probs=23.7
Q ss_pred hccCCCcccCcCCcCCCCCCCCCCccCCCCCCCCCCCCcceEEeeeEEeecC-CCcee
Q 001599 175 QQLSLPEEVSSSQVIQPAPPSSKSVRFPLRPGRGSTGTRCIVKANHFFAELP-DKDLH 231 (1047)
Q Consensus 175 ~~~~~~~~~s~~~~~~~~p~s~~~~~~p~RP~~Gt~G~~v~l~aN~f~v~~~-~~~iy 231 (1047)
+.+.+.+..-..+.+...|+..+.+ +||+ .+-++..|+=++-+. ...||
T Consensus 134 rsllvpsg~N~~qii~~~Pl~PIIV---~~P~-----~P~~~~~~~Pp~VVk~~PVi~ 183 (277)
T PF05387_consen 134 RSLLVPSGQNNHQIIIHQPLPPIIV---HQPG-----APPKVLNNHPPLVVKPAPVIY 183 (277)
T ss_pred hhhccccCCCCccEEEecCCCCeEe---cCCC-----CCchhhcCCCCeeecCCceEE
Confidence 3333333333334444445555544 4774 445556666665554 34455
No 35
>KOG3875 consensus Peroxisomal biogenesis protein peroxin [Intracellular trafficking, secretion, and vesicular transport]
Probab=25.49 E-value=2.6e+02 Score=31.43 Aligned_cols=18 Identities=22% Similarity=0.414 Sum_probs=12.3
Q ss_pred CCCccccccceEecCCcc
Q 001599 508 QRPNYLPMEVCKIVEGQR 525 (1047)
Q Consensus 508 ~~~~ylP~Elc~i~~gQ~ 525 (1047)
...-|+|.-.|+|..-|.
T Consensus 317 ~~tG~iP~NYvkIi~rq~ 334 (362)
T KOG3875|consen 317 GTTGLIPINYVKIIGRQP 334 (362)
T ss_pred CeeeeeehhhhhhhhcCC
Confidence 345688888888875443
No 36
>KOG3123 consensus Diphthine synthase [Translation, ribosomal structure and biogenesis]
Probab=25.47 E-value=89 Score=33.03 Aligned_cols=48 Identities=25% Similarity=0.402 Sum_probs=30.9
Q ss_pred CCceEEEEEeeCCCCchhhhhhHhhhcccCceeEeEeecccccccHHHHHHHH
Q 001599 693 KELDLLIVILPDNNGSLYGDLKRICETDLGLVSQCCLTKHVFKMSKQYMANVA 745 (1047)
Q Consensus 693 ~~~~lvlvilp~~~~~~Y~~IK~~~d~~~GI~TQcv~~~~~~k~~~q~~~Nv~ 745 (1047)
.-+.++++--.-+-.+.|+.||+ ..+.|++|-|++.=++ +.|.+.|++
T Consensus 130 etVSiv~ftd~wrP~SfydkI~~--Nr~~glHTLcLLDIkv---kEqs~enl~ 177 (272)
T KOG3123|consen 130 ETVSIVFFTDNWRPESFYDKIKE--NRQLGLHTLCLLDIKV---KEQSVENLA 177 (272)
T ss_pred cEEEEEEEccCcCchhHHHHHHH--hhhcCceeEEEEEEee---ccHHHHHHh
Confidence 44555544433355678999996 5889999999986443 334444443
No 37
>KOG1924 consensus RhoA GTPase effector DIA/Diaphanous [Signal transduction mechanisms; Cytoskeleton]
Probab=25.40 E-value=3e+02 Score=34.83 Aligned_cols=23 Identities=13% Similarity=0.058 Sum_probs=14.6
Q ss_pred CCCCCCCCCCcceEEeeeEEeecC
Q 001599 203 LRPGRGSTGTRCIVKANHFFAELP 226 (1047)
Q Consensus 203 ~RP~~Gt~G~~v~l~aN~f~v~~~ 226 (1047)
+|++.+. =.+-.+.-|+|-+++.
T Consensus 627 rr~nW~k-I~p~d~s~~cFWvkv~ 649 (1102)
T KOG1924|consen 627 RRFNWSK-IVPRDLSENCFWVKVN 649 (1102)
T ss_pred ccCCccc-cCccccCccceeeecc
Confidence 4555544 3445677888888765
No 38
>PF04094 DUF390: Protein of unknown function (DUF390); InterPro: IPR007228 This domain is found in a family of long proteins that are currently found only in rice. They have no known function. However they may be some kind of transposable element. There is a putative gypsy type transposon domain (IPR007321 from INTERPRO) towards the N terminus of the proteins.
Probab=24.29 E-value=3.6e+02 Score=33.85 Aligned_cols=10 Identities=20% Similarity=0.544 Sum_probs=5.0
Q ss_pred CCCCCEEEEE
Q 001599 870 NYQPPVTFVV 879 (1047)
Q Consensus 870 ~~~P~iT~Iv 879 (1047)
+--|+|+|-.
T Consensus 795 g~apr~~~~~ 804 (828)
T PF04094_consen 795 GSAPRLAFAL 804 (828)
T ss_pred CcCccccccC
Confidence 3346665543
No 39
>KOG0037 consensus Ca2+-binding protein, EF-Hand protein superfamily [Signal transduction mechanisms]
Probab=24.03 E-value=1.6e+02 Score=31.51 Aligned_cols=12 Identities=17% Similarity=0.432 Sum_probs=5.5
Q ss_pred chhhhHHhhccC
Q 001599 167 LSEVSQQFQQLS 178 (1047)
Q Consensus 167 ~~~~~~~~~~~~ 178 (1047)
.+.+++.++++.
T Consensus 56 ~~~~~~~f~~vD 67 (221)
T KOG0037|consen 56 FPQLAGWFQSVD 67 (221)
T ss_pred cHHHHHHHHhhC
Confidence 344455554443
No 40
>PF00763 THF_DHG_CYH: Tetrahydrofolate dehydrogenase/cyclohydrolase, catalytic domain; InterPro: IPR020630 Enzymes that participate in the transfer of one-carbon units require the coenzyme tetrahydrofolate (THF). Various reactions generate one-carbon derivatives of THF, which can be interconverted between different oxidation states by methylene-THF dehydrogenase (1.5.1.5 from EC), methenyl-THF cyclohydrolase (3.5.4.9 from EC) and formyl-THF synthetase (6.3.4.3 from EC) [, ]. The dehydrogenase and cyclohydrolase activities are expressed by a variety of multifunctional enzymes, including the tri-functional eukaryotic C1-tetrahydrofolate synthase []; a bifunctional eukaryotic mitochondrial protein; and the bifunctional Escherichia coli folD protein [, ]. Methylene-tetrahydrofolate dehydrogenase and methenyltetrahydrofolate cyclo-hydrolase share an overlapping active site [], and as such are usually located together in proteins, acting in tandem on the carbon-nitrogen bonds of substrates other than peptide bonds. This entry represents the N-terminal catalytic domain of these enzymes. ; GO: 0003824 catalytic activity, 0004488 methylenetetrahydrofolate dehydrogenase (NADP+) activity, 0009396 folic acid-containing compound biosynthetic process, 0055114 oxidation-reduction process; PDB: 2C2X_B 2C2Y_A 1EDZ_A 1EE9_A 4A26_B 3NGL_C 3NGX_A 1B0A_A 1DIA_A 1A4I_B ....
Probab=23.27 E-value=2.9e+02 Score=26.54 Aligned_cols=58 Identities=19% Similarity=0.244 Sum_probs=36.1
Q ss_pred CCCceEEEEEeeCC-CCchhhhhhHhhhcccCceeEeEeecccccccHHHHHHHHHHHHHh
Q 001599 692 GKELDLLIVILPDN-NGSLYGDLKRICETDLGLVSQCCLTKHVFKMSKQYMANVALKINVK 751 (1047)
Q Consensus 692 ~~~~~lvlvilp~~-~~~~Y~~IK~~~d~~~GI~TQcv~~~~~~k~~~q~~~Nv~lKiN~K 751 (1047)
+..|.|+++.+.++ .+..|...|...+.++||.+..+.... ....+-+..+.-++|.-
T Consensus 27 ~~~P~Laii~vg~d~~S~~Y~~~k~k~~~~~Gi~~~~~~l~~--~~~~~el~~~i~~lN~D 85 (117)
T PF00763_consen 27 GITPKLAIILVGDDPASISYVRSKQKAAEKLGIEFELIELPE--DISEEELLELIEKLNED 85 (117)
T ss_dssp T---EEEEEEES--HHHHHHHHHHHHHHHHHT-EEEEEEE-T--TSSHHHHHHHHHHHHH-
T ss_pred CCCcEEEEEecCCChhHHHHHHHHHHHHHHcCCceEEEECCC--CcCHHHHHHHHHHHhCC
Confidence 35688887777654 346799888878889999998886531 22445667777788754
No 41
>PF05642 Sporozoite_P67: Sporozoite P67 surface antigen; InterPro: IPR008845 This family consists of several Theileria P67 surface antigens. A stage specific surface antigen of Theileria parva, p67, is the basis for the development of an anti-sporozoite vaccine for the control of East Coast fever (ECF) in Bos taurus. The antigen has been shown to contain five distinct linear peptide sequences recognised by sporozoite-neutralising murine monoclonal antibodies [].
Probab=22.27 E-value=9.2e+02 Score=29.59 Aligned_cols=20 Identities=15% Similarity=0.150 Sum_probs=11.9
Q ss_pred HHHHHHHHHhcCcccccccc
Q 001599 742 ANVALKINVKVGGRNTVLVD 761 (1047)
Q Consensus 742 ~Nv~lKiN~KlGG~N~~l~~ 761 (1047)
.-|..||--||=|.-+.+..
T Consensus 694 egl~qk~k~k~lgsgfevas 713 (727)
T PF05642_consen 694 EGLIQKLKKKFLGSGFEVAS 713 (727)
T ss_pred hhHHHHHHHHhccCcceeee
Confidence 34566666666666665543
No 42
>PF04094 DUF390: Protein of unknown function (DUF390); InterPro: IPR007228 This domain is found in a family of long proteins that are currently found only in rice. They have no known function. However they may be some kind of transposable element. There is a putative gypsy type transposon domain (IPR007321 from INTERPRO) towards the N terminus of the proteins.
Probab=22.11 E-value=3.9e+02 Score=33.52 Aligned_cols=10 Identities=10% Similarity=0.418 Sum_probs=4.8
Q ss_pred cCccHHHHHH
Q 001599 406 EPLPVIDFVQ 415 (1047)
Q Consensus 406 ~~~~l~d~~~ 415 (1047)
...||+..|.
T Consensus 368 ~~ep~~~~la 377 (828)
T PF04094_consen 368 SAEPLLQVLA 377 (828)
T ss_pred ccchhhhhhh
Confidence 3345555543
No 43
>PRK14192 bifunctional 5,10-methylene-tetrahydrofolate dehydrogenase/ 5,10-methylene-tetrahydrofolate cyclohydrolase; Provisional
Probab=20.25 E-value=3.4e+02 Score=30.46 Aligned_cols=64 Identities=14% Similarity=0.115 Sum_probs=46.0
Q ss_pred CCceEEEEEeeCC-CCchhhhhhHhhhcccCceeEeEeec-ccccccHHHHHHHHHHHHHh--cCcccccc
Q 001599 693 KELDLLIVILPDN-NGSLYGDLKRICETDLGLVSQCCLTK-HVFKMSKQYMANVALKINVK--VGGRNTVL 759 (1047)
Q Consensus 693 ~~~~lvlvilp~~-~~~~Y~~IK~~~d~~~GI~TQcv~~~-~~~k~~~q~~~Nv~lKiN~K--lGG~N~~l 759 (1047)
..|.|.++.+.++ .+..|..+|.....++||.+..+... .+ ...-+.++.-++|.. +-|+|..+
T Consensus 32 ~~p~L~~i~vg~~~~s~~Y~~~~~~~~~~~Gi~~~~~~l~~~~---~~~~l~~~i~~Ln~d~~v~Gi~Vql 99 (283)
T PRK14192 32 RTPILATILVGDDPASATYVRMKGNACRRVGMDSLKVELPQET---TTEQLLAKIEELNANPDVHGILLQH 99 (283)
T ss_pred CCCeEEEEEeCCChhHHHHHHHHHHHHHHcCCeEEEEECCCCC---CHHHHHHHHHHHhCCCCCCEEEEeC
Confidence 4688887777654 45789999988888999998877652 22 233467888888865 67887654
Done!