Query         000417
Match_columns 1534
No_of_seqs    908 out of 5486
Neff          5.5 
Searched_HMMs 46136
Date          Fri Mar 29 07:53:45 2013
Command       hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/000417.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/000417hhsearch_cdd -cpu 12 -v 0 

 No Hit                             Prob E-value P-value  Score    SS Cols Query HMM  Template HMM
  1 KOG1082 Histone H3 (Lys9) meth 100.0 9.9E-43 2.1E-47  412.9  17.1  274 1225-1534   53-354 (364)
  2 KOG4442 Clathrin coat binding  100.0 2.3E-38   5E-43  379.6  12.7  163 1354-1533   93-259 (729)
  3 KOG1141 Predicted histone meth 100.0 7.9E-39 1.7E-43  381.2   6.5  199 1197-1419  620-839 (1262)
  4 KOG1080 Histone H3 (Lys4) meth  99.9   2E-27 4.4E-32  303.1  10.6  137 1379-1533  866-1004(1005)
  5 KOG1079 Transcriptional repres  99.9 1.7E-26 3.7E-31  276.1  10.1  132 1367-1515  582-713 (739)
  6 KOG2462 C2H2-type Zn-finger pr  99.9 6.8E-23 1.5E-27  226.9   3.2  137  880-1068  129-265 (279)
  7 smart00317 SET SET (Su(var)3-9  99.8 3.9E-21 8.5E-26  189.6  12.3  114 1380-1510    1-116 (116)
  8 KOG2462 C2H2-type Zn-finger pr  99.8   1E-21 2.2E-26  217.6   5.5  141  842-1040  125-265 (279)
  9 KOG1083 Putative transcription  99.8 2.8E-21 6.1E-26  238.4   2.0  131 1367-1514 1165-1297(1306)
 10 KOG3608 Zn finger proteins [Ge  99.7   5E-19 1.1E-23  199.0   1.9  189  847-1067  177-373 (467)
 11 KOG1074 Transcriptional repres  99.7 9.6E-18 2.1E-22  205.0   5.7  218  845-1071  603-932 (958)
 12 KOG1085 Predicted methyltransf  99.7 4.2E-17 9.1E-22  179.6   8.8  128 1373-1514  250-380 (392)
 13 KOG3608 Zn finger proteins [Ge  99.7 1.5E-17 3.2E-22  187.3   3.5  192  836-1059  196-399 (467)
 14 PF05033 Pre-SET:  Pre-SET moti  99.7 1.3E-16 2.7E-21  157.8   7.7  102 1236-1371    1-103 (103)
 15 KOG3623 Homeobox transcription  99.7 2.2E-17 4.7E-22  198.3   2.6   80  984-1070  894-973 (1007)
 16 KOG1074 Transcriptional repres  99.7 4.2E-17 9.2E-22  199.5   5.1  240  846-1101  352-719 (958)
 17 smart00468 PreSET N-terminal t  99.6 1.4E-15 3.1E-20  149.3   8.3   96 1234-1363    1-98  (98)
 18 COG2940 Proteins containing SE  99.6   1E-15 2.2E-20  189.0   2.5  164 1355-1533  308-479 (480)
 19 KOG3576 Ovo and related transc  99.3 3.2E-13   7E-18  143.5   0.5   85  844-940   114-198 (267)
 20 PF00856 SET:  SET domain;  Int  99.3 1.8E-12 3.8E-17  133.6   4.7  118 1390-1511    1-162 (162)
 21 KOG3576 Ovo and related transc  99.3 1.7E-12 3.8E-17  138.0   4.1  121  880-1047  116-241 (267)
 22 KOG3623 Homeobox transcription  99.2 5.4E-12 1.2E-16  152.7   1.8  125  882-1044  211-335 (1007)
 23 PLN03086 PRLI-interacting fact  98.8 6.3E-09 1.4E-13  128.7   6.0  139  882-1067  408-561 (567)
 24 KOG1081 Transcription factor N  98.7 4.5E-09 9.7E-14  129.0   1.9  145 1355-1533  289-436 (463)
 25 PLN03086 PRLI-interacting fact  98.7 1.3E-08 2.7E-13  126.1   5.3  143  846-1038  406-560 (567)
 26 PHA00733 hypothetical protein   98.6 1.5E-08 3.3E-13  104.6   3.5   87  914-1044   39-125 (128)
 27 KOG2589 Histone tail methylase  98.6 1.8E-08 3.9E-13  115.8   4.3  117 1387-1526  135-252 (453)
 28 KOG1141 Predicted histone meth  98.5 1.5E-07 3.3E-12  116.0   6.0  286 1228-1534  871-1262(1262)
 29 PHA00733 hypothetical protein   98.3 3.1E-07 6.8E-12   95.0   2.9   81  981-1068   37-121 (128)
 30 KOG3993 Transcription factor (  98.3 2.3E-07 4.9E-12  108.6   1.5  187  843-1042  263-483 (500)
 31 PHA02768 hypothetical protein;  98.1 6.5E-07 1.4E-11   78.8   0.0   42  985-1034    6-47  (55)
 32 PHA02768 hypothetical protein;  98.1   2E-06 4.4E-11   75.8   2.4   45 1018-1064    5-49  (55)
 33 KOG3993 Transcription factor (  98.0 2.1E-06 4.5E-11  100.8   2.6  171  881-1068  267-480 (500)
 34 KOG2461 Transcription factor B  97.8 2.3E-05 4.9E-10   94.9   5.8  114 1377-1515   26-147 (396)
 35 PF13465 zf-H2C2_2:  Zinc-finge  97.6 2.9E-05 6.2E-10   58.8   1.4   24  972-995     2-25  (26)
 36 PHA00732 hypothetical protein   97.4 0.00012 2.6E-09   69.9   3.1   48  984-1043    1-49  (79)
 37 PF13465 zf-H2C2_2:  Zinc-finge  97.3 0.00013 2.8E-09   55.3   2.1   25  999-1029    1-25  (26)
 38 PHA00616 hypothetical protein   97.2 6.6E-05 1.4E-09   63.5  -0.4   26  984-1010    1-26  (44)
 39 PHA00732 hypothetical protein   97.1 0.00026 5.7E-09   67.6   2.2   46 1018-1069    1-47  (79)
 40 PF05605 zf-Di19:  Drought indu  97.1 0.00035 7.6E-09   61.9   2.7   53  984-1043    2-54  (54)
 41 PHA00616 hypothetical protein   96.9 0.00029 6.4E-09   59.7   0.9   34 1018-1051    1-34  (44)
 42 PF05605 zf-Di19:  Drought indu  96.9 0.00084 1.8E-08   59.5   3.4   52  847-905     2-53  (54)
 43 COG5189 SFP1 Putative transcri  96.7 0.00084 1.8E-08   76.9   2.7   57  982-1038  347-418 (423)
 44 PF12756 zf-C2H2_2:  C2H2 type   95.7  0.0057 1.2E-07   59.4   2.2   72  917-1007    1-72  (100)
 45 PF00096 zf-C2H2:  Zinc finger,  95.6   0.006 1.3E-07   44.4   1.5   23  985-1008    1-23  (23)
 46 PF00096 zf-C2H2:  Zinc finger,  95.6  0.0029 6.2E-08   46.1  -0.2   23 1019-1041    1-23  (23)
 47 COG5189 SFP1 Putative transcri  95.6  0.0042 9.2E-08   71.4   1.0   67  845-934   347-417 (423)
 48 PF12756 zf-C2H2_2:  C2H2 type   95.6  0.0053 1.1E-07   59.6   1.5   73  849-938     1-73  (100)
 49 KOG1146 Homeobox protein [Gene  95.3  0.0064 1.4E-07   80.9   1.3  177  849-1041  438-641 (1406)
 50 PF13894 zf-C2H2_4:  C2H2-type   94.6  0.0092   2E-07   43.1   0.0   18  985-1002    1-18  (24)
 51 PF13912 zf-C2H2_6:  C2H2-type   94.5   0.015 3.2E-07   44.0   0.8   23 1019-1041    2-24  (27)
 52 PF13894 zf-C2H2_4:  C2H2-type   94.4   0.025 5.4E-07   40.8   1.8   22  883-904     2-23  (24)
 53 KOG2231 Predicted E3 ubiquitin  93.9   0.063 1.4E-06   68.7   5.3   11  848-858   100-110 (669)
 54 PF13912 zf-C2H2_6:  C2H2-type   93.9   0.034 7.4E-07   42.0   1.8   26  984-1010    1-26  (27)
 55 PF09237 GAGA:  GAGA factor;  I  93.3   0.028   6E-07   49.1   0.4   31 1016-1046   22-52  (54)
 56 smart00508 PostSET Cysteine-ri  93.0   0.047   1E-06   41.6   1.2   15 1519-1533    2-16  (26)
 57 KOG2231 Predicted E3 ubiquitin  93.0   0.087 1.9E-06   67.5   4.3  109  918-1044  118-238 (669)
 58 KOG1146 Homeobox protein [Gene  92.5   0.066 1.4E-06   71.8   2.3  158  884-1068  439-640 (1406)
 59 cd01395 HMT_MBD Methyl-CpG bin  91.1   0.048   1E-06   49.7  -0.8   36 1184-1219    1-48  (60)
 60 smart00355 ZnF_C2H2 zinc finge  90.6    0.17 3.6E-06   36.8   1.8   24  985-1009    1-24  (26)
 61 COG5048 FOG: Zn-finger [Genera  90.5    0.19 4.1E-06   60.3   3.3   62  990-1055  394-455 (467)
 62 PRK04860 hypothetical protein;  90.5   0.098 2.1E-06   56.7   0.8   39  983-1031  118-156 (160)
 63 PRK04860 hypothetical protein;  90.4    0.16 3.5E-06   55.0   2.3   36 1018-1057  119-154 (160)
 64 COG5236 Uncharacterized conser  90.2    0.17 3.8E-06   59.1   2.5   84  847-940   151-245 (493)
 65 cd05162 PWWP The PWWP domain,   89.7    0.31 6.8E-06   47.2   3.4   60  157-220     6-66  (87)
 66 smart00355 ZnF_C2H2 zinc finge  89.4    0.27 5.8E-06   35.7   2.1   20  883-902     2-21  (26)
 67 PF09237 GAGA:  GAGA factor;  I  88.5    0.29 6.2E-06   43.1   1.9   29  880-908    23-51  (54)
 68 COG5048 FOG: Zn-finger [Genera  88.5    0.28   6E-06   58.8   2.6  139  915-1070  289-442 (467)
 69 cd05840 SPBC215_ISWI_like The   88.1    0.37 7.9E-06   47.8   2.7   59  157-216     6-65  (93)
 70 PF13909 zf-H2C2_5:  C2H2-type   86.9    0.17 3.7E-06   37.3  -0.3   22 1019-1041    1-22  (24)
 71 PF11722 zf-TRM13_CCCH:  CCCH z  85.6    0.24 5.3E-06   39.4  -0.0   29  533-561     2-30  (31)
 72 PF12874 zf-met:  Zinc-finger o  85.3    0.26 5.6E-06   36.5  -0.0   19 1020-1038    2-20  (25)
 73 PF12874 zf-met:  Zinc-finger o  85.1     0.4 8.7E-06   35.5   0.9   20  883-902     2-21  (25)
 74 PF13909 zf-H2C2_5:  C2H2-type   83.9    0.63 1.4E-05   34.3   1.5   23  882-905     1-23  (24)
 75 KOG4173 Alpha-SNAP protein [In  83.6    0.42 9.1E-06   52.8   0.6   91  880-1010   78-172 (253)
 76 PF12171 zf-C2H2_jaz:  Zinc-fin  83.6    0.64 1.4E-05   35.4   1.5   22 1019-1040    2-23  (27)
 77 COG5236 Uncharacterized conser  83.4    0.62 1.3E-05   54.8   1.9  130  881-1067  151-302 (493)
 78 smart00570 AWS associated with  82.1    0.54 1.2E-05   41.7   0.6   24 1353-1376   26-49  (51)
 79 KOG4173 Alpha-SNAP protein [In  81.2    0.44 9.5E-06   52.7  -0.3   87  845-940    77-171 (253)
 80 KOG2785 C2H2-type Zn-finger pr  80.4     2.4 5.2E-05   51.2   5.3   26  984-1010  166-191 (390)
 81 KOG2482 Predicted C2H2-type Zn  79.6     3.1 6.7E-05   49.4   5.7   26  985-1010  280-305 (423)
 82 KOG2084 Predicted histone tail  79.2     2.3 4.9E-05   52.8   4.9   53 1466-1526  208-271 (482)
 83 PF12171 zf-C2H2_jaz:  Zinc-fin  78.3     1.1 2.4E-05   34.1   1.2   21  882-902     2-22  (27)
 84 KOG2482 Predicted C2H2-type Zn  75.1     2.8   6E-05   49.8   3.7   23 1018-1040  334-356 (423)
 85 KOG2893 Zn finger protein [Gen  69.4     1.8 3.8E-05   48.9   0.5   48  883-940    12-59  (341)
 86 cd05837 MSH6_like The PWWP dom  64.8     6.9 0.00015   40.0   3.7   63  157-219     8-71  (110)
 87 COG4049 Uncharacterized protei  62.1     3.1 6.7E-05   37.3   0.5   35  839-873     9-43  (65)
 88 KOG2785 C2H2-type Zn-finger pr  61.2     3.3 7.2E-05   50.1   0.7  172  881-1067    3-241 (390)
 89 smart00451 ZnF_U1 U1-like zinc  57.9     6.2 0.00013   31.4   1.5   25  881-905     3-27  (35)
 90 KOG2893 Zn finger protein [Gen  57.5     3.3 7.1E-05   46.9  -0.1   47  987-1043   13-60  (341)
 91 KOG1337 N-methyltransferase [G  56.3       8 0.00017   49.0   3.0   40 1466-1512  239-278 (472)
 92 PF13913 zf-C2HC_2:  zinc-finge  55.1       9  0.0002   29.1   1.9   18  883-901     4-21  (25)
 93 smart00451 ZnF_U1 U1-like zinc  54.5     4.6  0.0001   32.2   0.3   21 1018-1038    3-23  (35)
 94 PF13913 zf-C2HC_2:  zinc-finge  51.3      10 0.00022   28.9   1.6   17  985-1002    3-19  (25)
 95 COG0068 HypF Hydrogenase matur  47.9     6.9 0.00015   50.9   0.5   13  943-955   102-114 (750)
 96 COG4049 Uncharacterized protei  43.8      10 0.00023   34.2   0.8   33  978-1010   11-43  (65)
 97 KOG3813 Uncharacterized conser  40.7      13 0.00027   46.6   1.1   19 1299-1318  307-325 (640)
 98 PF12013 DUF3505:  Protein of u  39.7      34 0.00074   34.7   3.9   27 1017-1043   79-109 (109)
 99 smart00293 PWWP domain with co  39.6      32 0.00069   31.6   3.3   56  157-215     6-62  (63)
100 PF00855 PWWP:  PWWP domain;  I  38.3      31 0.00068   32.9   3.3   56  157-219     6-62  (86)
101 cd00350 rubredoxin_like Rubred  37.1      23 0.00049   28.6   1.7   10 1045-1054   16-25  (33)
102 COG1198 PriA Primosomal protei  36.8      17 0.00037   48.3   1.5   42 1112-1154  603-645 (730)
103 PF09538 FYDLN_acid:  Protein o  36.2      18  0.0004   37.1   1.3   30  985-1031   10-39  (108)
104 TIGR02098 MJ0042_CXXC MJ0042 f  35.2      19 0.00041   29.6   1.0   34  985-1029    3-36  (38)
105 cd05838 WHSC1_related The PWWP  35.0      30 0.00065   34.6   2.6   54  158-214     7-61  (95)
106 TIGR00373 conserved hypothetic  34.5      26 0.00056   38.2   2.2   39  974-1027   99-137 (158)
107 PF09986 DUF2225:  Uncharacteri  34.3      23 0.00049   40.5   1.8   42 1016-1057    3-59  (214)
108 PF13891 zf-C3Hc3H:  Potential   33.8      14  0.0003   34.5  -0.0   24  587-610     3-26  (65)
109 smart00531 TFIIE Transcription  33.2      31 0.00067   37.0   2.5   39  980-1028   95-133 (147)
110 smart00391 MBD Methyl-CpG bind  32.2      16 0.00034   35.3   0.1   25 1195-1219   27-52  (77)
111 PF14353 CpXC:  CpXC protein     31.9      29 0.00062   36.2   2.0   49  986-1041    3-61  (128)
112 PF09986 DUF2225:  Uncharacteri  31.7      14  0.0003   42.2  -0.5   13  916-928    49-61  (214)
113 KOG2186 Cell growth-regulating  31.3      23  0.0005   41.0   1.2   44  882-934     4-47  (276)
114 PF09538 FYDLN_acid:  Protein o  30.4      33 0.00072   35.3   2.1   31  847-894     9-39  (108)
115 PRK06266 transcription initiat  29.7      31 0.00068   38.3   1.9   34  980-1028  113-146 (178)
116 PF11722 zf-TRM13_CCCH:  CCCH z  29.4      30 0.00065   27.9   1.2   21  589-609    11-31  (31)
117 KOG2461 Transcription factor B  27.7      73  0.0016   39.8   4.8   81  968-1054  315-395 (396)
118 cd05839 BR140_related The PWWP  27.4      92   0.002   32.3   4.6   61  157-217     6-80  (111)
119 smart00834 CxxC_CXXC_SSSS Puta  27.2      20 0.00043   29.6  -0.1   11  985-995     6-16  (41)
120 PHA00626 hypothetical protein   26.8      22 0.00048   32.3   0.1   13 1018-1030   23-35  (59)
121 PF06524 NOA36:  NOA36 protein;  25.8      40 0.00087   39.2   1.9   11  846-856    62-72  (314)
122 TIGR02605 CxxC_CxxC_SSSS putat  25.4      24 0.00053   30.9   0.1   11  985-995     6-16  (52)
123 PF09723 Zn-ribbon_8:  Zinc rib  25.3      21 0.00046   30.4  -0.3   12  985-996     6-17  (42)
124 PRK00464 nrdR transcriptional   25.3      26 0.00057   38.1   0.4   40  985-1030    1-40  (154)
125 PF12013 DUF3505:  Protein of u  25.2      61  0.0013   32.9   2.9   24  916-939    81-108 (109)
126 TIGR02300 FYDLN_acid conserved  24.8      43 0.00093   35.3   1.7   30  985-1031   10-39  (129)
127 PF08879 WRC:  WRC;  InterPro:   24.8      26 0.00056   30.8   0.1   20  589-608    13-32  (46)
128 COG1997 RPL43A Ribosomal prote  24.1      31 0.00067   34.1   0.5   32  983-1030   34-65  (89)
129 PF02892 zf-BED:  BED zinc fing  24.0      58  0.0013   27.6   2.1   28  981-1008   13-44  (45)
130 COG1198 PriA Primosomal protei  24.0      51  0.0011   44.1   2.7   25 1016-1055  460-484 (730)
131 TIGR00622 ssl1 transcription f  23.6      57  0.0012   33.8   2.3   24 1018-1041   81-104 (112)
132 COG1996 RPC10 DNA-directed RNA  23.4      41 0.00089   30.0   1.1   29  983-1027    5-33  (49)
133 PRK14890 putative Zn-ribbon RN  22.9      53  0.0011   30.3   1.7   32  983-1026   24-56  (59)
134 PF08666 SAF:  SAF domain;  Int  21.7      53  0.0011   29.4   1.5   15 1493-1507    3-17  (63)
135 PF14353 CpXC:  CpXC protein     21.3      34 0.00074   35.6   0.3   20  983-1002   37-56  (128)
136 COG2888 Predicted Zn-ribbon RN  21.2      61  0.0013   30.0   1.7   33  983-1026   26-58  (61)
137 cd05834 HDGF_related The PWWP   21.1 1.2E+02  0.0026   29.7   3.9   52  157-218     8-60  (83)
138 KOG1280 Uncharacterized conser  20.8      57  0.0012   39.5   1.9   29  982-1010   77-105 (381)
139 PF13717 zinc_ribbon_4:  zinc-r  20.5      66  0.0014   26.6   1.7   14  986-999     4-17  (36)
140 KOG2593 Transcription initiati  20.4      58  0.0012   40.6   1.9   47  972-1027  116-162 (436)
141 smart00531 TFIIE Transcription  20.4      58  0.0013   35.0   1.8   39  957-995    96-134 (147)

No 1  
>KOG1082 consensus Histone H3 (Lys9) methyltransferase SUV39H1/Clr4, required for transcriptional silencing [Chromatin structure and dynamics; Transcription]
Probab=100.00  E-value=9.9e-43  Score=412.88  Aligned_cols=274  Identities=34%  Similarity=0.531  Sum_probs=214.7

Q ss_pred             CcCCCCceeeecCCCCCCCCCeeEeeCCCCcccccccCCCCCcccccCCCCCCCcEEeccCCCCCCCCCcccCCCCCccc
Q 000417         1225 KPLLRGTVLCDDISSGLESVPVACVVDDGLLETLCISADSSDSQKTRCSMPWESFTYVTKPLLDQSLDLDAESLQLGCAC 1304 (1534)
Q Consensus      1225 ~~~~~~~~i~~DIS~G~E~vPV~~vnd~D~~~~~~~~g~~~~~~~~~~~~P~~~F~Yi~~~~~~~~~~~d~e~~~~GC~C 1304 (1534)
                      ..+.+...+..||+.|.|++||+.+|++|..                  .| ..|+|++..++..+. ........||.|
T Consensus        53 ~~~~~~~~~~~d~~~~~e~~~v~~~n~id~~------------------~~-~~f~y~~~~~~~~~~-~~~~~~~~~c~C  112 (364)
T KOG1082|consen   53 KDKLEAKSELEDIALGSENLPVPLVNRIDED------------------AP-LYFQYIATEIVDPGE-LSDCENSTGCRC  112 (364)
T ss_pred             ccccccccccccccCccccCceeeeeeccCC------------------cc-ccceeccccccCccc-cccCccccCCCc
Confidence            4455677889999999999999999999863                  12 579999999887752 222345689999


Q ss_pred             CCCCcCCCC---CCcccccccccccccccCCCCcCCCcccCCCCc--eeecCCceEEecCCCCCCCCCCCCcccccCcee
Q 000417         1305 ANSTCFPET---CDHVYLFDNDYEDAKDIDGKSVHGRFPYDQTGR--VILEEGYLIYECNHMCSCDRTCPNRVLQNGVRV 1379 (1534)
Q Consensus      1305 ~~~~C~p~~---C~C~~l~~~~y~~~~~i~g~~~~g~~~Yd~~G~--l~~~~~~~IyECn~~C~C~~~C~NRvvQ~g~~~ 1379 (1534)
                      .+ .|....   |.|..               .+.+.++|..+|.  .....+.+||||++.|+|++.|.|||+|.|++.
T Consensus       113 ~~-~~~~~~~~~C~C~~---------------~n~~~~~~~~~~~~~~~~~~~~~i~EC~~~C~C~~~C~nRv~q~g~~~  176 (364)
T KOG1082|consen  113 CS-SCSSVLPLTCLCER---------------HNGGLVAYTCDGDCGTLGKFKEPVFECSVACGCHPDCANRVVQKGLQF  176 (364)
T ss_pred             cC-CCCCCCCccccChH---------------hhCCccccccCCccccccccCccccccccCCCCCCcCcchhhcccccc
Confidence            86 444332   67643               2335567776663  334456799999999999999999999999999


Q ss_pred             eEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhccccCC----CcceEEecCccccc--------ccccc
Q 000417         1380 KLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRSRYGRD----GCGYMLNIGAHIND--------MGRLI 1447 (1534)
Q Consensus      1380 ~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~~y~~~----~~sYlf~ld~~~~d--------~~~l~ 1447 (1534)
                      +|+||+|+.+|||||++++|++|+|||||+||+++..+++.|...+...    +..+.+..+.....        .....
T Consensus       177 ~leIfrt~~kGwgvRs~~~I~~G~fvcEyaGe~~t~~e~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~  256 (364)
T KOG1082|consen  177 HLEVFRTPEKGWGVRTLDPIPAGEFVCEYAGEVLTSEEAQRRTHLREYLDDDCDAYSIADREWVDESPVGNTFVAPSLPG  256 (364)
T ss_pred             ceEEEecCCceeeecccccccCCCeeEEEeeEecChHHhhhccccccccccccccchhhhcccccccccccccccccccc
Confidence            9999999999999999999999999999999999999999875432221    11122222211000        00111


Q ss_pred             cCceeEEEeccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCCC-----------C
Q 000417         1448 EGQVRYVIDATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYELL-----------S 1516 (1534)
Q Consensus      1448 ~~~~~~~IDA~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~~-----------~ 1516 (1534)
                      .....++|||+.+||++|||||||.||+.++.|+.++.++..++|+|||++||+||||||||||..+.           .
T Consensus       257 ~~~~~~~ida~~~GNv~RfinHSC~PN~~~~~v~~~~~~~~~~~i~ffa~~~I~p~~ELT~dYg~~~~~~~~~~~~~~~~  336 (364)
T KOG1082|consen  257 GPGRELLIDAKPHGNVARFINHSCSPNLLYQAVFQDEFVLLYLRIGFFALRDISPGEELTLDYGKAYKLLVQDGANIYTP  336 (364)
T ss_pred             CCCcceEEchhhcccccccccCCCCccceeeeeeecCCccchheeeeeeccccCCCcccchhhccccccccccccccccc
Confidence            22468999999999999999999999999999999999999999999999999999999999997753           2


Q ss_pred             CCCceeeCCCCCCccccC
Q 000417         1517 GEGYPCHCGASKCRGRLY 1534 (1534)
Q Consensus      1517 ~~~~~C~CGS~~CRG~l~ 1534 (1534)
                      .....|.||+.+||++++
T Consensus       337 ~~~~~c~c~~~~cr~~~~  354 (364)
T KOG1082|consen  337 VMKKNCNCGLEKCRGLLG  354 (364)
T ss_pred             ccchhhcCCCHHhCcccC
Confidence            246789999999999874


No 2  
>KOG4442 consensus Clathrin coat binding protein/Huntingtin interacting protein HIP1, involved in regulation of endocytosis [Intracellular trafficking, secretion, and vesicular transport]
Probab=100.00  E-value=2.3e-38  Score=379.58  Aligned_cols=163  Identities=42%  Similarity=0.780  Sum_probs=152.3

Q ss_pred             eEEecCC-CCC-CCCCCCCcccccCceeeEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhccccCCC--
Q 000417         1354 LIYECNH-MCS-CDRTCPNRVLQNGVRVKLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRSRYGRDG-- 1429 (1534)
Q Consensus      1354 ~IyECn~-~C~-C~~~C~NRvvQ~g~~~~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~~y~~~~-- 1429 (1534)
                      ...||++ .|. |+..|.|+.+|+....+++||.|+.+||||||.++|++|+||+||.||||+..|+++|...|...+  
T Consensus        93 t~iECs~~~C~~cg~~C~NQRFQkkqyA~vevF~Te~KG~GLRA~~dI~~g~FI~EY~GEVI~~~Ef~kR~~~Y~~d~~k  172 (729)
T KOG4442|consen   93 TSIECSDRECPRCGVYCKNQRFQKKQYAKVEVFLTEKKGCGLRAEEDIPKGQFILEYIGEVIEEKEFEKRVKRYAKDGIK  172 (729)
T ss_pred             hhcccCCccCCCccccccchhhhhhccCceeEEEecCcccceeeccccCCCcEEeeeccccccHHHHHHHHHHHHhcCCc
Confidence            3469998 999 999999999999999999999999999999999999999999999999999999999999997764  


Q ss_pred             cceEEecCcccccccccccCceeEEEeccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEE
Q 000417         1430 CGYMLNIGAHINDMGRLIEGQVRYVIDATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYD 1509 (1534)
Q Consensus      1430 ~sYlf~ld~~~~d~~~l~~~~~~~~IDA~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~D 1509 (1534)
                      +.|+|.+..             .++|||+.+||+||||||||+|||.++.|.|.    +..||+|||.|+|++|||||||
T Consensus       173 h~Yfm~L~~-------------~e~IDAT~KGnlaRFiNHSC~PNa~~~KWtV~----~~lRvGiFakk~I~~GEEITFD  235 (729)
T KOG4442|consen  173 HYYFMALQG-------------GEYIDATKKGNLARFINHSCDPNAEVQKWTVP----DELRVGIFAKKVIKPGEEITFD  235 (729)
T ss_pred             eEEEEEecC-------------CceecccccCcHHHhhcCCCCCCceeeeeeeC----CeeEEEEeEecccCCCceeeEe
Confidence            346665543             68999999999999999999999999999998    6899999999999999999999


Q ss_pred             cCCCCCCCCCceeeCCCCCCcccc
Q 000417         1510 YHYELLSGEGYPCHCGASKCRGRL 1533 (1534)
Q Consensus      1510 Yg~~~~~~~~~~C~CGS~~CRG~l 1533 (1534)
                      |+++....+..+|+||+++|||||
T Consensus       236 Yqf~rYGr~AQ~CyCgeanC~G~I  259 (729)
T KOG4442|consen  236 YQFDRYGRDAQPCYCGEANCRGWI  259 (729)
T ss_pred             cccccccccccccccCCccccccc
Confidence            999998888999999999999997


No 3  
>KOG1141 consensus Predicted histone methyl transferase [Chromatin structure and dynamics]
Probab=100.00  E-value=7.9e-39  Score=381.21  Aligned_cols=199  Identities=23%  Similarity=0.339  Sum_probs=142.7

Q ss_pred             cccCCCCcCCc-ccccccee-eeccc-------cc---------CCCcCCCCceeeecCCCCCCCCCeeEeeCCCCcccc
Q 000417         1197 SSDSSDFVNNQ-WEVDECHC-IIDSR-------HL---------GRKPLLRGTVLCDDISSGLESVPVACVVDDGLLETL 1258 (1534)
Q Consensus      1197 ~v~~~~~~~~~-~~~~e~~~-~l~~~-------~~---------~~~~~~~~~~i~~DIS~G~E~vPV~~vnd~D~~~~~ 1258 (1534)
                      -|.|..|||.- +.|.|+.+ +++.+       .|         +..++.++++.|-||++|+|.+||.++|+.|..   
T Consensus       620 hv~yktpcg~~lr~~~el~ryL~et~c~flf~~~f~~~~yV~~~r~~~p~kp~~~~~Di~~g~e~vpis~~neids~---  696 (1262)
T KOG1141|consen  620 HVEYKTPCGMPLRMRIELYRYLVETRCKFLFVIGFDRAFYVVRHRAPNPLKPGNRCTDIPCGREHVPISEKNEIDSH---  696 (1262)
T ss_pred             eeeccCCCccchHHHHHHHHHHHHhcCcEEEEeecccchheeecccCCCcCCcceeccccCCccccccceeecccCc---
Confidence            37799999988 77777554 33332       12         233466888999999999999999999999852   


Q ss_pred             cccCCCCCcccccCCCCCCCcEEeccCCCCCCCCCc-ccCCCCCcccCCCCcCCCCCCcccccccccccccccCCC-CcC
Q 000417         1259 CISADSSDSQKTRCSMPWESFTYVTKPLLDQSLDLD-AESLQLGCACANSTCFPETCDHVYLFDNDYEDAKDIDGK-SVH 1336 (1534)
Q Consensus      1259 ~~~g~~~~~~~~~~~~P~~~F~Yi~~~~~~~~~~~d-~e~~~~GC~C~~~~C~p~~C~C~~l~~~~y~~~~~i~g~-~~~ 1336 (1534)
                                      |++.|.|-...+.....=.+ ...|+.+|+|.+|+-+..+|.|.++....-..  .-++. ...
T Consensus       697 ----------------~lpq~ay~K~~ip~~~nl~n~~~~fl~scdc~~gcid~~kcachQltvk~~~t--~p~~~v~~t  758 (1262)
T KOG1141|consen  697 ----------------RLPQAAYKKHMIPTNNNLSNRRKDFLQSCDCPTGCIDSMKCACHQLTVKKKTT--GPNQNVAST  758 (1262)
T ss_pred             ----------------CCccchhheeeccCCCcccccChhhhhcCCCCcchhhhhhhhHHHHHHHhhcc--CCCcccccC
Confidence                            23578887776655432111 24578999999865566789998764321100  00000 001


Q ss_pred             CCcccCCCCceeecCCceEEecCCCCCCCC-CCCCcccccCceeeEEEEecCCCCccccccccccCCCeEEEeeeEeecH
Q 000417         1337 GRFPYDQTGRVILEEGYLIYECNHMCSCDR-TCPNRVLQNGVRVKLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDE 1415 (1534)
Q Consensus      1337 g~~~Yd~~G~l~~~~~~~IyECn~~C~C~~-~C~NRvvQ~g~~~~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~ 1415 (1534)
                      ..+.|.   |++-.....+|||+..|+|.+ -|.||++|+|.+++|++|+|..+|||+|..++|.+|.|||.|.|-+++.
T Consensus       759 ~gykyK---Rl~e~~ptg~yEc~k~ckc~~~~C~nrmvqhg~qvRlq~fkt~~kGWg~rclddi~~g~fVciy~g~~l~~  835 (1262)
T KOG1141|consen  759 NGYKYK---RLIEIRPTGPYECLKACKCCGPDCLNRMVQHGYQVRLQRFKTIHKGWGRRCLDDITGGNFVCIYPGGALLH  835 (1262)
T ss_pred             cchhhH---HHHHhcCCCHHHHHHhhccCcHHHHHHHhhcCceeEeeeccccccccceEeeeecCCceEEEEecchhhhh
Confidence            123332   333333457999999999987 5999999999999999999999999999999999999999999999865


Q ss_pred             HHHH
Q 000417         1416 LETN 1419 (1534)
Q Consensus      1416 ~ea~ 1419 (1534)
                      .-++
T Consensus       836 ~~sd  839 (1262)
T KOG1141|consen  836 QISD  839 (1262)
T ss_pred             hhch
Confidence            5443


No 4  
>KOG1080 consensus Histone H3 (Lys4) methyltransferase complex, subunit SET1 and related methyltransferases [Chromatin structure and dynamics; Transcription]
Probab=99.94  E-value=2e-27  Score=303.09  Aligned_cols=137  Identities=42%  Similarity=0.738  Sum_probs=125.9

Q ss_pred             eeEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhccccCC--CcceEEecCcccccccccccCceeEEEe
Q 000417         1379 VKLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRSRYGRD--GCGYMLNIGAHINDMGRLIEGQVRYVID 1456 (1534)
Q Consensus      1379 ~~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~~y~~~--~~sYlf~ld~~~~d~~~l~~~~~~~~ID 1456 (1534)
                      ..|...++..+||||||+++|.+|++|+||+||++...-|+.|+.+|...  +.+|+|.+|.             .++||
T Consensus       866 k~~~F~~s~iH~wglfa~~~i~~~dmViEY~Ge~vR~~iad~RE~~Y~~~gi~~sYlfrid~-------------~~ViD  932 (1005)
T KOG1080|consen  866 KYVKFGRSGIHGWGLFAMENIAAGDMVIEYRGELVRSSIADLREARYERMGIGDSYLFRIDD-------------EVVVD  932 (1005)
T ss_pred             hhhccccccccccceeeccCccccceEEEeeceehhhhHHHHHHHHHhccCcccceeeeccc-------------ceEEe
Confidence            34777789999999999999999999999999999999999999888765  4789999986             58999


Q ss_pred             ccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCCCCCCCceeeCCCCCCcccc
Q 000417         1457 ATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYELLSGEGYPCHCGASKCRGRL 1533 (1534)
Q Consensus      1457 A~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~~~~~~~~C~CGS~~CRG~l 1533 (1534)
                      |+..||+||||||||+|||.+..+.|+    +..+|+|||.|||.+||||||||.+.... ...+|+|||++|||+|
T Consensus       933 Atk~gniAr~InHsC~PNCyakvi~V~----g~~~IvIyakr~I~~~EElTYDYkF~~e~-~kipClCgap~Crg~~ 1004 (1005)
T KOG1080|consen  933 ATKKGNIARFINHSCNPNCYAKVITVE----GDKRIVIYSKRDIAAGEELTYDYKFPTED-DKIPCLCGAPNCRGFL 1004 (1005)
T ss_pred             ccccCchhheeecccCCCceeeEEEec----CeeEEEEEEecccccCceeeeeccccccc-cccccccCCCcccccc
Confidence            999999999999999999999999999    67799999999999999999999988654 3899999999999997


No 5  
>KOG1079 consensus Transcriptional repressor EZH1 [Transcription]
Probab=99.93  E-value=1.7e-26  Score=276.13  Aligned_cols=132  Identities=34%  Similarity=0.659  Sum_probs=126.8

Q ss_pred             CCCCcccccCceeeEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhccccCCCcceEEecCccccccccc
Q 000417         1367 TCPNRVLQNGVRVKLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRSRYGRDGCGYMLNIGAHINDMGRL 1446 (1534)
Q Consensus      1367 ~C~NRvvQ~g~~~~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~~y~~~~~sYlf~ld~~~~d~~~l 1446 (1534)
                      +|.|--+|+|.+.++.+..+...|||+|+.+.+.+++||.||+||+|+.+||++|+..|+....+|||++..        
T Consensus       582 ~C~N~~l~~~~qkr~llapSdVaGwGlFlKe~v~KnefisEY~GE~IS~dEADrRGkiYDr~~cSflFnln~--------  653 (739)
T KOG1079|consen  582 SCKNTNLQRGEQKRVLLAPSDVAGWGLFLKESVSKNEFISEYTGEIISHDEADRRGKIYDRYMCSFLFNLNN--------  653 (739)
T ss_pred             ccccchhhhhhhcceeechhhccccceeeccccCCCceeeeecceeccchhhhhcccccccccceeeeeccc--------
Confidence            799999999999999999999999999999999999999999999999999999999999999999999876        


Q ss_pred             ccCceeEEEeccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCCC
Q 000417         1447 IEGQVRYVIDATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYELL 1515 (1534)
Q Consensus      1447 ~~~~~~~~IDA~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~~ 1515 (1534)
                           .|+|||++.||.+||+|||=+|||.+..+++.    +..+|+|||.|+|.+||||||||+|+-.
T Consensus       654 -----dyviDs~rkGnk~rFANHS~nPNCYAkvm~V~----GdhRIGifAkRaIeagEELffDYrYs~~  713 (739)
T KOG1079|consen  654 -----DYVIDSTRKGNKIRFANHSFNPNCYAKVMMVA----GDHRIGIFAKRAIEAGEELFFDYRYSPE  713 (739)
T ss_pred             -----cceEeeeeecchhhhccCCCCCCcEEEEEEec----CCcceeeeehhhcccCceeeeeeccCcc
Confidence                 59999999999999999999999999988888    7889999999999999999999998753


No 6  
>KOG2462 consensus C2H2-type Zn-finger protein [Transcription]
Probab=99.86  E-value=6.8e-23  Score=226.88  Aligned_cols=137  Identities=18%  Similarity=0.211  Sum_probs=109.2

Q ss_pred             CccccCccCcccCChHHHHhHhhhcccccccccccccccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCC
Q 000417          880 RGYACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGED  959 (1534)
Q Consensus       880 kpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geK  959 (1534)
                      ..|+|..|+|.+.+.++|.+|.++|.....   .+-+.|++|+|.|.+...|+.| .++|+                   
T Consensus       129 ~r~~c~eCgk~ysT~snLsrHkQ~H~~~~s---~ka~~C~~C~K~YvSmpALkMH-irTH~-------------------  185 (279)
T KOG2462|consen  129 PRYKCPECGKSYSTSSNLSRHKQTHRSLDS---KKAFSCKYCGKVYVSMPALKMH-IRTHT-------------------  185 (279)
T ss_pred             Cceeccccccccccccccchhhcccccccc---cccccCCCCCceeeehHHHhhH-hhccC-------------------
Confidence            447777777777777777777777665433   2567888888888888888888 55554                   


Q ss_pred             CCccccCCCchhhhhhhhhcCCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccc
Q 000417          960 SPKKLELGYSASVENHSENLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPR 1039 (1534)
Q Consensus       960 p~~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r 1039 (1534)
                                             -+++|.+|||.|.+..-|+- |+|+|||     ||||.|+.|+|+|..+++|+.||+
T Consensus       186 -----------------------l~c~C~iCGKaFSRPWLLQG-HiRTHTG-----EKPF~C~hC~kAFADRSNLRAHmQ  236 (279)
T KOG2462|consen  186 -----------------------LPCECGICGKAFSRPWLLQG-HIRTHTG-----EKPFSCPHCGKAFADRSNLRAHMQ  236 (279)
T ss_pred             -----------------------CCcccccccccccchHHhhc-ccccccC-----CCCccCCcccchhcchHHHHHHHH
Confidence                                   56788888888888888888 7888888     888888888888888888888888


Q ss_pred             cccCCCCccCCCCCCcCCChHHHHhhccc
Q 000417         1040 FKKGLGAVSYRIRNRGAAGMKKRIQTLKP 1068 (1534)
Q Consensus      1040 ~H~gekpy~C~iCgksFs~~~~L~kH~Ks 1068 (1534)
                      +|.+.|+|+|..|+|+|+.++.|.+|..+
T Consensus       237 THS~~K~~qC~~C~KsFsl~SyLnKH~ES  265 (279)
T KOG2462|consen  237 THSDVKKHQCPRCGKSFALKSYLNKHSES  265 (279)
T ss_pred             hhcCCccccCcchhhHHHHHHHHHHhhhh
Confidence            88888888888888888888888888764


No 7  
>smart00317 SET SET (Su(var)3-9, Enhancer-of-zeste, Trithorax) domain. Putative methyl transferase, based on outlier plant homologues
Probab=99.85  E-value=3.9e-21  Score=189.61  Aligned_cols=114  Identities=47%  Similarity=0.790  Sum_probs=97.1

Q ss_pred             eEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhccccCCC--cceEEecCcccccccccccCceeEEEec
Q 000417         1380 KLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRSRYGRDG--CGYMLNIGAHINDMGRLIEGQVRYVIDA 1457 (1534)
Q Consensus      1380 ~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~~y~~~~--~sYlf~ld~~~~d~~~l~~~~~~~~IDA 1457 (1534)
                      ++++++++.+|+||+|+++|++|++|++|.|.++...++..+...+....  ..|+|....             .++||+
T Consensus         1 ~~~~~~~~~~G~gl~a~~~i~~g~~i~~~~g~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-------------~~~id~   67 (116)
T smart00317        1 KLEVFKSPGKGWGVRATEDIPKGEFIGEYVGEIITSEEAEERSKAYDTDGADSFYLFEIDS-------------DLCIDA   67 (116)
T ss_pred             CcEEEecCCCcEEEEECCccCCCCEEEEEEeEEECHHHHHHHHHHHHhcCCCCEEEEECCC-------------CEEEeC
Confidence            36788899999999999999999999999999999888877653232222  367777543             579999


Q ss_pred             cccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEc
Q 000417         1458 TKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDY 1510 (1534)
Q Consensus      1458 ~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DY 1510 (1534)
                      ...||++|||||||.||+.+..+..+    +..++.|+|+|||++|||||+||
T Consensus        68 ~~~~~~~~~iNHsc~pN~~~~~~~~~----~~~~~~~~a~r~I~~GeEi~i~Y  116 (116)
T smart00317       68 RRKGNIARFINHSCEPNCELLFVEVN----GDSRIVIFALRDIKPGEELTIDY  116 (116)
T ss_pred             CccCcHHHeeCCCCCCCEEEEEEEEC----CCcEEEEEECCCcCCCCEEeecC
Confidence            99999999999999999999888775    34489999999999999999999


No 8  
>KOG2462 consensus C2H2-type Zn-finger protein [Transcription]
Probab=99.84  E-value=1e-21  Score=217.60  Aligned_cols=141  Identities=20%  Similarity=0.346  Sum_probs=126.4

Q ss_pred             ccCCCcccCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcccccccccccccccccC
Q 000417          842 SEDEKTHKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPC  921 (1534)
Q Consensus       842 h~gekpykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~C  921 (1534)
                      ......|+|+.|+|.+.+.++|.+| +.+|..-.  ..+.+.|++|+|.|.+...|+.|+++|+        .+++|.+|
T Consensus       125 ~~~~~r~~c~eCgk~ysT~snLsrH-kQ~H~~~~--s~ka~~C~~C~K~YvSmpALkMHirTH~--------l~c~C~iC  193 (279)
T KOG2462|consen  125 AAKHPRYKCPECGKSYSTSSNLSRH-KQTHRSLD--SKKAFSCKYCGKVYVSMPALKMHIRTHT--------LPCECGIC  193 (279)
T ss_pred             cccCCceeccccccccccccccchh-hccccccc--ccccccCCCCCceeeehHHHhhHhhccC--------CCcccccc
Confidence            3455679999999999999999999 88997642  2378999999999999999999999987        35789999


Q ss_pred             CCccCChHHHhhhhhccccCcccchhhhhhcccccCCCCCccccCCCchhhhhhhhhcCCcceeeecccCCccCChhHHH
Q 000417          922 GSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSPKKLELGYSASVENHSENLGSIRKFICRFCGLKFDLLPDLG 1001 (1534)
Q Consensus       922 gK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKsF~sks~Lk 1001 (1534)
                      ||.|...-.|+-|                                         +|+|+|||||.|+.|+|.|..+++|+
T Consensus       194 GKaFSRPWLLQGH-----------------------------------------iRTHTGEKPF~C~hC~kAFADRSNLR  232 (279)
T KOG2462|consen  194 GKAFSRPWLLQGH-----------------------------------------IRTHTGEKPFSCPHCGKAFADRSNLR  232 (279)
T ss_pred             cccccchHHhhcc-----------------------------------------cccccCCCCccCCcccchhcchHHHH
Confidence            9999987776666                                         67889999999999999999999999


Q ss_pred             HHHHhhccCCCCCCCCCcccCCCCcccCCchhhhccccc
Q 000417         1002 RHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRF 1040 (1534)
Q Consensus      1002 rHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~ 1040 (1534)
                      . |+++|.+     .|+|+|+.|+|.|..++.|.+|...
T Consensus       233 A-HmQTHS~-----~K~~qC~~C~KsFsl~SyLnKH~ES  265 (279)
T KOG2462|consen  233 A-HMQTHSD-----VKKHQCPRCGKSFALKSYLNKHSES  265 (279)
T ss_pred             H-HHHhhcC-----CccccCcchhhHHHHHHHHHHhhhh
Confidence            9 8999999     8999999999999999999999743


No 9  
>KOG1083 consensus Putative transcription factor ASH1/LIN-59 [Transcription]
Probab=99.81  E-value=2.8e-21  Score=238.37  Aligned_cols=131  Identities=43%  Similarity=0.714  Sum_probs=117.1

Q ss_pred             CCCCccccc-CceeeEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHH-hccccCCCcceEEecCccccccc
Q 000417         1367 TCPNRVLQN-GVRVKLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKR-RSRYGRDGCGYMLNIGAHINDMG 1444 (1534)
Q Consensus      1367 ~C~NRvvQ~-g~~~~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R-~~~y~~~~~sYlf~ld~~~~d~~ 1444 (1534)
                      +|.|+.+|+ +.-.+|+||+.+.+||||+|.++|++|+||+||+|||++..+.+.+ ...|-...+.|+..++.      
T Consensus      1165 ~c~nqrm~r~e~cp~L~v~~gp~~G~~v~tk~PikagtfI~EYvGeVit~ke~e~~mmtl~~~d~~~~cL~I~p------ 1238 (1306)
T KOG1083|consen 1165 SCSNQRMQRHEECPPLEVFRGPKKGWGVRTKEPIKAGTFIMEYVGEVITEKEFEPRMMTLYHNDDDHYCLVIDP------ 1238 (1306)
T ss_pred             hhhhHHhhhhccCCCcceeccCCCCccccccccccccchHHHHHHHHHHHHhhcccccccCCCCCcccccccCc------
Confidence            377776664 6677899999999999999999999999999999999999998877 34466667778888776      


Q ss_pred             ccccCceeEEEeccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCC
Q 000417         1445 RLIEGQVRYVIDATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYEL 1514 (1534)
Q Consensus      1445 ~l~~~~~~~~IDA~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~ 1514 (1534)
                             ..+||+.++||.+|||||||.|||..+.|.++    ++.||++||+|||.+||||||||+...
T Consensus      1239 -------~l~id~~R~~n~~RfinhscKPNc~~qkwSVN----G~~Rv~L~A~rDi~kGEELtYDYN~ks 1297 (1306)
T KOG1083|consen 1239 -------GLFIDIPRMGNGARFINHSCKPNCEMQKWSVN----GEYRVGLFALRDLPKGEELTYDYNFKS 1297 (1306)
T ss_pred             -------cccCChhhccccccccccccCCCCcccccccc----ceeeeeeeecCCCCCCceEEEeccccc
Confidence                   57999999999999999999999999999999    899999999999999999999998653


No 10 
>KOG3608 consensus Zn finger proteins [General function prediction only]
Probab=99.73  E-value=5e-19  Score=199.03  Aligned_cols=189  Identities=19%  Similarity=0.219  Sum_probs=164.4

Q ss_pred             cccCC--CCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcccccccccccccccccCCCc
Q 000417          847 THKCK--ICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSH  924 (1534)
Q Consensus       847 pykC~--~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~  924 (1534)
                      .+.|.  -|-+.|.++..|++| .++|+++     |...|+.|+.-|.++..|.-|.+..+.-..    .+|+|..|.|.
T Consensus       177 v~~C~W~~Ct~~~~~k~~LreH-~r~Hs~e-----KvvACp~Cg~~F~~~tkl~DH~rRqt~l~~----n~fqC~~C~Kr  246 (467)
T KOG3608|consen  177 VTMCNWAMCTKHMGNKYRLREH-IRTHSNE-----KVVACPHCGELFRTKTKLFDHLRRQTELNT----NSFQCAQCFKR  246 (467)
T ss_pred             eeeccchhhhhhhccHHHHHHH-HHhcCCC-----eEEecchHHHHhccccHHHHHHHhhhhhcC----CchHHHHHHHH
Confidence            36664  699999999999999 8999999     899999999999999999999987765432    58999999999


Q ss_pred             cCChHHHhhhhhccccCcccchhhhhhcccccCCCCCccccCCCchhhhhhhh-hcCCcceeeecccCCccCChhHHHHH
Q 000417          925 FGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSPKKLELGYSASVENHSE-NLGSIRKFICRFCGLKFDLLPDLGRH 1003 (1534)
Q Consensus       925 Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~~C~~Cgk~~sLk~Hlr-tHtgeKpykC~~CgKsF~sks~LkrH 1003 (1534)
                      |.++..|..| ++.|..-|+|+.|...              |+..++|.+|++ .|...|||+|+.|++.|.+.++|.+ 
T Consensus       247 FaTeklL~~H-v~rHvn~ykCplCdmt--------------c~~~ssL~~H~r~rHs~dkpfKCd~Cd~~c~~esdL~k-  310 (467)
T KOG3608|consen  247 FATEKLLKSH-VVRHVNCYKCPLCDMT--------------CSSASSLTTHIRYRHSKDKPFKCDECDTRCVRESDLAK-  310 (467)
T ss_pred             HhHHHHHHHH-HHHhhhcccccccccC--------------CCChHHHHHHHHhhhccCCCccccchhhhhccHHHHHH-
Confidence            9999999999 7778755666555432              556789999997 5889999999999999999999999 


Q ss_pred             HHhhccCCCCCCCCCcccCC--CCcccCCchhhhccccccc-CC--CCccCCCCCCcCCChHHHHhhcc
Q 000417         1004 HQAAHMGPNLVNSRPHKKGI--RFYAYKLKSGRLSRPRFKK-GL--GAVSYRIRNRGAAGMKKRIQTLK 1067 (1534)
Q Consensus      1004 H~rtHtge~~~~eKpYkC~i--C~K~F~sks~L~rH~r~H~-ge--kpy~C~iCgksFs~~~~L~kH~K 1067 (1534)
                      |..+|..      -.|+|+.  |.++|++...|++|++.|+ |.  -+|+|..|++.|.+-.+|..|..
T Consensus       311 H~~~HS~------~~y~C~h~~C~~s~r~~~q~~~H~~evhEg~np~~Y~CH~Cdr~ft~G~~L~~HL~  373 (467)
T KOG3608|consen  311 HVQVHSK------TVYQCEHPDCHYSVRTYTQMRRHFLEVHEGNNPILYACHCCDRFFTSGKSLSAHLM  373 (467)
T ss_pred             HHHhccc------cceecCCCCCcHHHHHHHHHHHHHHHhccCCCCCceeeecchhhhccchhHHHHHH
Confidence            6779985      4799998  9999999999999997655 55  55999999999999999999965


No 11 
>KOG1074 consensus Transcriptional repressor SALM [Transcription]
Probab=99.69  E-value=9.6e-18  Score=205.05  Aligned_cols=218  Identities=17%  Similarity=0.191  Sum_probs=153.6

Q ss_pred             CCcccCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcccccccccccccccc---cC
Q 000417          845 EKTHKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCI---PC  921 (1534)
Q Consensus       845 ekpykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~---~C  921 (1534)
                      -.|-+|-+|-++...++.|+.| .++|++|     |||+|++|++.|.++.+|+.||-.|.......  -.|.|+   +|
T Consensus       603 TdPNqCiiC~rVlSC~saLqmH-yrtHtGE-----RPFkCKiCgRAFtTkGNLkaH~~vHka~p~~R--~q~ScP~~~ic  674 (958)
T KOG1074|consen  603 TDPNQCIICLRVLSCPSALQMH-YRTHTGE-----RPFKCKICGRAFTTKGNLKAHMSVHKAKPPAR--VQFSCPSTFIC  674 (958)
T ss_pred             CCccceeeeeecccchhhhhhh-hhcccCc-----CccccccccchhccccchhhcccccccCcccc--ccccCCchhhh
Confidence            4578999999999999999999 8999999     99999999999999999999999888765554  679999   99


Q ss_pred             CCccCChHHHhhhhhccccCc---------------ccchhhhhhcccccCCC---------------------------
Q 000417          922 GSHFGNTEELWLHVQSVHAID---------------FKMSEVAQQHNQSVGED---------------------------  959 (1534)
Q Consensus       922 gK~Fssk~~Lk~H~~rvH~~e---------------f~C~~C~k~f~~~~geK---------------------------  959 (1534)
                      .+.|.+.-.|..| .++|.+.               -+|..|.+.|.......                           
T Consensus       675 ~~kftn~V~lpQh-IriH~~~~~s~g~~a~e~~~~adq~~~~qk~~~~a~~f~~~~se~~~~~s~~~~~~~~~t~t~~~~  753 (958)
T KOG1074|consen  675 QKKFTNAVTLPQH-IRIHLGGQISNGGTAAEGILAADQCSSCQKTFSDARSFSQQISEQPSPESEPDEQMDERTETEELD  753 (958)
T ss_pred             cccccccccccce-EEeecCCCCCCCcccccccchhcccchhhhcccccccchhhhhccCCcccCCcccccccccccccc
Confidence            9999999999999 7888632               46777777664221111                           


Q ss_pred             ---CCccccCCCchh---------------------------hhhhhhhcCCccee-eecccCCccCChhHHH----HH-
Q 000417          960 ---SPKKLELGYSAS---------------------------VENHSENLGSIRKF-ICRFCGLKFDLLPDLG----RH- 1003 (1534)
Q Consensus       960 ---p~~C~~Cgk~~s---------------------------Lk~HlrtHtgeKpy-kC~~CgKsF~sks~Lk----rH- 1003 (1534)
                         +..+..|+..+.                           -..+...++++++. .|.+|+..-...-...    .- 
T Consensus       754 ~tp~~~e~~~~~~~~~e~~i~~~g~te~asa~~~~vg~~s~~~~~~~~~~T~~k~~~~~~~~~~~~~~~v~~~pvl~~~~  833 (958)
T KOG1074|consen  754 VTPPPPENSCGRELEGEMAISVRGSTEEASANLDEVGTVSAAGEAGEEDDTSEKPTQASSFPGEILAPSVNMDPVLWNQE  833 (958)
T ss_pred             cCCCccccccccccCcccccccccchhhhhcChhhhcCccccchhhhhcccCCCCcccccCCCcCCccccccCchhhccc
Confidence               222333331110                           01111223344444 4555543322211100    00 


Q ss_pred             ------------HHhhccCCC-------------------CCCCCCcccCCCCcccCCchhhhcccccccCCCCccCCCC
Q 000417         1004 ------------HQAAHMGPN-------------------LVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRIR 1052 (1534)
Q Consensus      1004 ------------H~rtHtge~-------------------~~~eKpYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~iC 1052 (1534)
                                  -..+|.++.                   ........|.+|++.|...+.|..|+|+|+++|||.|.+|
T Consensus       834 ~~~l~eg~~t~~n~~t~~~~~~sv~qs~~~p~l~p~l~~~~pvnn~h~C~vCgk~FsSSsALqiH~rTHtg~KPF~C~fC  913 (958)
T KOG1074|consen  834 TSMLNEGLATKTNEITPEGPADSVIQSGGVPTLEPSLGRPGPVNNAHVCNVCGKQFSSSAALEIHMRTHTGPKPFFCHFC  913 (958)
T ss_pred             ccccccccccccccccCCCcchhhhhhccccccCCCCCCCCcccchhhhccchhcccchHHHHHhhhcCCCCCCccchhh
Confidence                        000000000                   0002347899999999999999999999999999999999


Q ss_pred             CCcCCChHHHHhhccccCC
Q 000417         1053 NRGAAGMKKRIQTLKPLAS 1071 (1534)
Q Consensus      1053 gksFs~~~~L~kH~KsH~~ 1071 (1534)
                      ++.|..+..|+.|+.+|..
T Consensus       914 ~~aFttrgnLKvHMgtH~w  932 (958)
T KOG1074|consen  914 EEAFTTRGNLKVHMGTHMW  932 (958)
T ss_pred             hhhhhhhhhhhhhhccccc
Confidence            9999999999999999864


No 12 
>KOG1085 consensus Predicted methyltransferase (contains a SET domain) [General function prediction only]
Probab=99.69  E-value=4.2e-17  Score=179.62  Aligned_cols=128  Identities=38%  Similarity=0.514  Sum_probs=109.8

Q ss_pred             cccCceeeEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhccccCCC--cceEEecCcccccccccccCc
Q 000417         1373 LQNGVRVKLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRSRYGRDG--CGYMLNIGAHINDMGRLIEGQ 1450 (1534)
Q Consensus      1373 vQ~g~~~~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~~y~~~~--~sYlf~ld~~~~d~~~l~~~~ 1450 (1534)
                      +..|....|.+..-.+||.||+|...+.+|+||.||.|.+|...||..|+..|..+.  -.|+|.+...          .
T Consensus       250 vl~g~~egl~~~~~dgKGRGv~a~~~F~rgdFVVEY~Gdliei~eAk~rE~~Ya~De~~GcYMYyF~h~----------s  319 (392)
T KOG1085|consen  250 VLKGTNEGLLEVYKDGKGRGVRAKVNFERGDFVVEYRGDLIEISEAKVREEQYANDEEIGCYMYYFEHN----------S  319 (392)
T ss_pred             HHhccccceeEEeeccccceeEeecccccCceEEEEecceeeechHHHHHHHhccCcccceEEEeeecc----------C
Confidence            345666677777777899999999999999999999999999999999998886543  3577765442          2


Q ss_pred             eeEEEeccc-cCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCC
Q 000417         1451 VRYVIDATK-YGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYEL 1514 (1534)
Q Consensus      1451 ~~~~IDA~~-~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~ 1514 (1534)
                      ..|||||+. .+-++|.||||-.+||....|.++    +.||+.+.|.|||.+||||+||||+..
T Consensus       320 k~yCiDAT~et~~lGRLINHS~~gNl~TKvv~Id----g~pHLiLvA~rdIa~GEELlYDYGDRS  380 (392)
T KOG1085|consen  320 KKYCIDATKETPWLGRLINHSVRGNLKTKVVEID----GSPHLILVARRDIAQGEELLYDYGDRS  380 (392)
T ss_pred             eeeeeecccccccchhhhcccccCcceeeEEEec----CCceEEEEeccccccchhhhhhccccc
Confidence            479999987 566899999999999999999999    899999999999999999999999753


No 13 
>KOG3608 consensus Zn finger proteins [General function prediction only]
Probab=99.67  E-value=1.5e-17  Score=187.32  Aligned_cols=192  Identities=18%  Similarity=0.294  Sum_probs=164.1

Q ss_pred             ccccccccCCCcccCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcccccccccccc
Q 000417          836 LAIAGRSEDEKTHKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVEQCML  915 (1534)
Q Consensus       836 ~~~~~~h~gekpykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kp  915 (1534)
                      .++.+.|+++|...|+.|+..|.++..|-.|+++.-...    ..+|.|..|.|.|.++..|..|+..|-.-        
T Consensus       196 reH~r~Hs~eKvvACp~Cg~~F~~~tkl~DH~rRqt~l~----~n~fqC~~C~KrFaTeklL~~Hv~rHvn~--------  263 (467)
T KOG3608|consen  196 REHIRTHSNEKVVACPHCGELFRTKTKLFDHLRRQTELN----TNSFQCAQCFKRFATEKLLKSHVVRHVNC--------  263 (467)
T ss_pred             HHHHHhcCCCeEEecchHHHHhccccHHHHHHHhhhhhc----CCchHHHHHHHHHhHHHHHHHHHHHhhhc--------
Confidence            356689999999999999999999999999965443222    27899999999999999999999988654        


Q ss_pred             cccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCCCCccccCCCc----hhhhhhhhhcCCcceeeecc--
Q 000417          916 QQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSPKKLELGYS----ASVENHSENLGSIRKFICRF--  989 (1534)
Q Consensus       916 ykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~~C~~Cgk~----~sLk~HlrtHtgeKpykC~~--  989 (1534)
                      |+|+.|+.+....++|.+|++..|.                ..||++|..|.+.    +.|.+|..+|+ +-.|.|+.  
T Consensus       264 ykCplCdmtc~~~ssL~~H~r~rHs----------------~dkpfKCd~Cd~~c~~esdL~kH~~~HS-~~~y~C~h~~  326 (467)
T KOG3608|consen  264 YKCPLCDMTCSSASSLTTHIRYRHS----------------KDKPFKCDECDTRCVRESDLAKHVQVHS-KTVYQCEHPD  326 (467)
T ss_pred             ccccccccCCCChHHHHHHHHhhhc----------------cCCCccccchhhhhccHHHHHHHHHhcc-ccceecCCCC
Confidence            8899999999999999999988897                5788888888744    47999999999 67899988  


Q ss_pred             cCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccccCC------CCccCCCCCCcCCCh
Q 000417          990 CGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGL------GAVSYRIRNRGAAGM 1059 (1534)
Q Consensus       990 CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~ge------kpy~C~iCgksFs~~ 1059 (1534)
                      |..+|++...|++|.+.+|.|.+   .-+|.|..|++.|++..+|.+|++..++.      +.|..+.|.-+|.++
T Consensus       327 C~~s~r~~~q~~~H~~evhEg~n---p~~Y~CH~Cdr~ft~G~~L~~HL~kkH~f~~PsGh~RFtYk~~edG~mRL  399 (467)
T KOG3608|consen  327 CHYSVRTYTQMRRHFLEVHEGNN---PILYACHCCDRFFTSGKSLSAHLMKKHGFRLPSGHKRFTYKVDEDGFMRL  399 (467)
T ss_pred             CcHHHHHHHHHHHHHHHhccCCC---CCceeeecchhhhccchhHHHHHHHhhcccCCCCCCceeeeeccCceeee
Confidence            99999999999998788887733   56899999999999999999999666554      457778888877543


No 14 
>PF05033 Pre-SET:  Pre-SET motif;  InterPro: IPR007728 This region is found in a number of histone lysine methyltransferases (HMTase), N-terminal to the SET domain; it is generally described as the pre-SET domain. Histone lysine methylation is part of the histone code that regulated chromatin function and epigenetic control of gene function. Histone lysine methyltransferases (HMTase) differ both in their substrate specificity for the various acceptor lysines as well as in their product specificity for the number of methyl groups (one, two, or three) they transfer. With just one exception [], the HMTases belong to SET family that can be classified according to the sequences surrounding the SET domain [, ]. Structural studies on the human SET7/9, a mono-methylase, have revealed the molecular basis for the specificity of the enzyme for the histone-target and the roles of the invariant residues in the SET domain in determining the methylation specificities [].  The pre-SET domain, as found in the SUV39 SET family, contains nine invariant cysteine residues that are grouped into two segments separated by a region of variable length. These 9 cysteines coordinate 3 zinc ions to form a triangular cluster, where each of the zinc ions is coordinated by 4 four cysteines to give a tetrahedral configuration. The function of this domain is structural, holding together 2 long segments of random coils and stabilising the SET domain. The C-terminal region including the post-SET domain is disordered when not interacting with a histone tail and in the absence of zinc. The three conserved cysteines in the post-SET domain form a zinc-binding site [] when coupled to a fourth conserved cysteine in the knot-like structure close to the SET domain active site []. The structured post-SET region brings in the C-terminal residues that participate in S-adenosylmethine-binding and histone tail interactions. The three conserved cysteine residues are essential for HMTase activity, as replacement with serine abolishes HMTase activity []. ; GO: 0008270 zinc ion binding, 0018024 histone-lysine N-methyltransferase activity, 0034968 histone lysine methylation, 0005634 nucleus; PDB: 3K5K_A 2O8J_D 3RJW_B 1ML9_A 1PEG_B 1MVH_A 1MVX_A 3BO5_A 2RFI_B 3MO5_B ....
Probab=99.66  E-value=1.3e-16  Score=157.77  Aligned_cols=102  Identities=32%  Similarity=0.664  Sum_probs=69.2

Q ss_pred             cCCCCCCCCCeeEeeCCCCcccccccCCCCCcccccCCCCCCCcEEeccCCCCCCCCCcccCCCCCcccCCCCc-CCCCC
Q 000417         1236 DISSGLESVPVACVVDDGLLETLCISADSSDSQKTRCSMPWESFTYVTKPLLDQSLDLDAESLQLGCACANSTC-FPETC 1314 (1534)
Q Consensus      1236 DIS~G~E~vPV~~vnd~D~~~~~~~~g~~~~~~~~~~~~P~~~F~Yi~~~~~~~~~~~d~e~~~~GC~C~~~~C-~p~~C 1314 (1534)
                      |||.|+|++||+++|++|+.                  .||..|+||+++++..++......+..||+|.+ .| .+.+|
T Consensus         1 Dis~g~e~~pI~~~N~vd~~------------------~~p~~F~Yi~~~~~~~~~~~~~~~~~~~C~C~~-~C~~~~~C   61 (103)
T PF05033_consen    1 DISRGKENVPIPVVNDVDDE------------------PPPPNFEYIPENIYGEGVPDIDPEFLQGCDCSG-DCSNPSNC   61 (103)
T ss_dssp             -TTCTSSSS-EEEEESSSS--------------------SSTSSEE-SS-EESTTSS-TBGGGTS----SS-SSTCTTTS
T ss_pred             CCCCCccCCCEEEEeCCCCC------------------CCCCCeEEeeeEEcCCCccccccccCccCccCC-CCCCCCCC
Confidence            89999999999999999963                  234799999999998876523345678999975 57 67889


Q ss_pred             CcccccccccccccccCCCCcCCCcccCCCCceeecCCceEEecCCCCCCCCCCCCc
Q 000417         1315 DHVYLFDNDYEDAKDIDGKSVHGRFPYDQTGRVILEEGYLIYECNHMCSCDRTCPNR 1371 (1534)
Q Consensus      1315 ~C~~l~~~~y~~~~~i~g~~~~g~~~Yd~~G~l~~~~~~~IyECn~~C~C~~~C~NR 1371 (1534)
                      .|+..+               ++.++|+.+|+|......+|||||+.|+|+.+|+||
T Consensus        62 ~C~~~~---------------~~~~~Y~~~g~l~~~~~~~i~EC~~~C~C~~~C~NR  103 (103)
T PF05033_consen   62 ECLQRN---------------GGIFAYDSNGRLRIPDKPPIFECNDNCGCSPSCRNR  103 (103)
T ss_dssp             HHHCCT---------------SSS-SB-TTSSBSSSSTSEEE---TTSSS-TTSTT-
T ss_pred             cCcccc---------------CccccccCCCcCccCCCCeEEeCCCCCCCCCCCCCC
Confidence            997532               234689999998877889999999999999999998


No 15 
>KOG3623 consensus Homeobox transcription factor SIP1 [Transcription]
Probab=99.66  E-value=2.2e-17  Score=198.28  Aligned_cols=80  Identities=21%  Similarity=0.246  Sum_probs=76.3

Q ss_pred             eeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccccCCCCccCCCCCCcCCChHHHH
Q 000417          984 KFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRIRNRGAAGMKKRI 1063 (1534)
Q Consensus       984 pykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~iCgksFs~~~~L~ 1063 (1534)
                      .|.|+.|+|.|...+.|.+ |+--|+|     .|||+|.+|.|+|+.+..|..|+|.|.|+|||.|+.|+|.|+...+..
T Consensus       894 myaCDqCDK~FqKqSSLaR-HKYEHsG-----qRPyqC~iCkKAFKHKHHLtEHkRLHSGEKPfQCdKClKRFSHSGSYS  967 (1007)
T KOG3623|consen  894 MYACDQCDKAFQKQSSLAR-HKYEHSG-----QRPYQCIICKKAFKHKHHLTEHKRLHSGEKPFQCDKCLKRFSHSGSYS  967 (1007)
T ss_pred             cchHHHHHHHHHhhHHHHH-hhhhhcC-----CCCcccchhhHhhhhhhhhhhhhhhccCCCcchhhhhhhhcccccchH
Confidence            3899999999999999999 8999999     999999999999999999999999999999999999999999988888


Q ss_pred             hhccccC
Q 000417         1064 QTLKPLA 1070 (1534)
Q Consensus      1064 kH~KsH~ 1070 (1534)
                      +||. |.
T Consensus       968 QHMN-HR  973 (1007)
T KOG3623|consen  968 QHMN-HR  973 (1007)
T ss_pred             hhhc-cc
Confidence            8887 64


No 16 
>KOG1074 consensus Transcriptional repressor SALM [Transcription]
Probab=99.66  E-value=4.2e-17  Score=199.52  Aligned_cols=240  Identities=21%  Similarity=0.232  Sum_probs=161.8

Q ss_pred             CcccCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhccccccccc------ccccccc
Q 000417          846 KTHKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVEQ------CMLQQCI  919 (1534)
Q Consensus       846 kpykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~------~kpykC~  919 (1534)
                      -+++|.+|.|.|.+.+.|+.| .+.|+++     +||+|.+||..|.++.+|+.|...|+..-+..+      ...++|.
T Consensus       352 ~khkCr~CakvfgS~SaLqiH-lRSHTGE-----RPfqCnvCG~~FSTkGNLKvH~~rH~e~~p~~~m~p~~~~e~l~~~  425 (958)
T KOG1074|consen  352 FKHKCRFCAKVFGSDSALQIH-LRSHTGE-----RPFQCNVCGNRFSTKGNLKVHFQRHREKYPHVQMNPHPVQEHLQYV  425 (958)
T ss_pred             ccchhhhhHhhcCchhhhhhh-hhccCCC-----CCeeecccccccccccceeeeeeeccccCCccccCCCCchhhhcce
Confidence            357899999999999999999 8999999     999999999999999999999988876532221      1235666


Q ss_pred             cCCCccCChHHHhhhhhccccCc-------------ccch------hh--------hhhcccc-----------------
Q 000417          920 PCGSHFGNTEELWLHVQSVHAID-------------FKMS------EV--------AQQHNQS-----------------  955 (1534)
Q Consensus       920 ~CgK~Fssk~~Lk~H~~rvH~~e-------------f~C~------~C--------~k~f~~~-----------------  955 (1534)
                      +|.-.|.+-....-|-...|...             -.++      .+        ...|...                 
T Consensus       426 i~st~~p~g~~vpp~k~~~~~~~~e~~~~~~sts~g~~~~~~~~~sv~~~~ts~~~~~~~s~~~~~~~~~i~~~s~e~e~  505 (958)
T KOG1074|consen  426 ITSTGLPYGPSVPPEKAEEEAATVEPKLLVRSTSVGSATESLTPSSVSFGETSAPPLPAFSKFVLMKTVEIKSKSEEPEP  505 (958)
T ss_pred             eeccccCCCCCCCCCCCcchhccccccccccccccCCCCCcccccccccccccCCCCCccccccccCCcccccccCCCCc
Confidence            66666655444444421111100             0000      00        0000000                 


Q ss_pred             ------------------------------------------cCCCCCccccCCCch-hhhhhhh-----hc--------
Q 000417          956 ------------------------------------------VGEDSPKKLELGYSA-SVENHSE-----NL--------  979 (1534)
Q Consensus       956 ------------------------------------------~geKp~~C~~Cgk~~-sLk~Hlr-----tH--------  979 (1534)
                                                                .....|.+...+-.- .+.+-+.     -+        
T Consensus       506 ~vs~g~~~~~~~~gs~l~~s~~ks~~s~~~~~~~~~~~asa~m~~~~~~~~p~g~s~~~~aq~~~l~d~~~~~~~~~~ts  585 (958)
T KOG1074|consen  506 AVSEGSAISGVLEGSPLRMSSGKSVESLPVEADLLNHAASAGMFPPSYVSRPLGPSEDTTAQALQLVDKIPEALIEISTS  585 (958)
T ss_pred             cccccccccccccCCccccccccCccccchhccccchhhccccCCchhhcCCCCcchhhHHHhhhhhccChhhcceeecc
Confidence                                                      001111122111000 0111110     00        


Q ss_pred             ---------------CCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccccCC
Q 000417          980 ---------------GSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGL 1044 (1534)
Q Consensus       980 ---------------tgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~ge 1044 (1534)
                                     ....|-+|-+|-++..-++.|+. |.|+|+|     +|||+|.+|+++|.++.+|+.||-+|...
T Consensus       586 seS~kl~slv~~~~~~~TdPNqCiiC~rVlSC~saLqm-HyrtHtG-----ERPFkCKiCgRAFtTkGNLkaH~~vHka~  659 (958)
T KOG1074|consen  586 SESPKLTSLVENSENKRTDPNQCIICLRVLSCPSALQM-HYRTHTG-----ERPFKCKICGRAFTTKGNLKAHMSVHKAK  659 (958)
T ss_pred             cCCccccccccccccccCCccceeeeeecccchhhhhh-hhhcccC-----cCccccccccchhccccchhhcccccccC
Confidence                           00146799999999999999999 8999999     99999999999999999999999999876


Q ss_pred             C----CccCC---CCCCcCCChHHHHhhccccCCCCcccCCCcccccccCccccccchhhhhhh
Q 000417         1045 G----AVSYR---IRNRGAAGMKKRIQTLKPLASGEIVEQPKATEVVTLGTLVESQCSTLSRIL 1101 (1534)
Q Consensus      1045 k----py~C~---iCgksFs~~~~L~kH~KsH~~~~~tsqp~~sEt~~s~~L~~~qCs~v~k~L 1101 (1534)
                      -    .++|+   +|.+.|.+...|.+|.++|..+....-...    ..+.+...||+.+.+.+
T Consensus       660 p~~R~q~ScP~~~ic~~kftn~V~lpQhIriH~~~~~s~g~~a----~e~~~~adq~~~~qk~~  719 (958)
T KOG1074|consen  660 PPARVQFSCPSTFICQKKFTNAVTLPQHIRIHLGGQISNGGTA----AEGILAADQCSSCQKTF  719 (958)
T ss_pred             ccccccccCCchhhhcccccccccccceEEeecCCCCCCCccc----ccccchhcccchhhhcc
Confidence            3    48999   999999999999999999864433222111    24556777888777765


No 17 
>smart00468 PreSET N-terminal to some SET domains. A Cys-rich putative Zn2+-binding domain that occurs N-terminal to some SET domains. Function is unknown. Unpublished.
Probab=99.60  E-value=1.4e-15  Score=149.29  Aligned_cols=96  Identities=34%  Similarity=0.652  Sum_probs=78.5

Q ss_pred             eecCCCCCCCCCeeEeeCCCCcccccccCCCCCcccccCCCCCCCcEEeccCCCCCCCCC-cccCCCCCcccCCCCcCCC
Q 000417         1234 CDDISSGLESVPVACVVDDGLLETLCISADSSDSQKTRCSMPWESFTYVTKPLLDQSLDL-DAESLQLGCACANSTCFPE 1312 (1534)
Q Consensus      1234 ~~DIS~G~E~vPV~~vnd~D~~~~~~~~g~~~~~~~~~~~~P~~~F~Yi~~~~~~~~~~~-d~e~~~~GC~C~~~~C~p~ 1312 (1534)
                      +.|||+|+|++||++||++|+.                  .|+.+|+||++++++.++.+ ....+..||+|.+ .|++.
T Consensus         1 ~~Dis~G~E~~pI~~vN~vD~~------------------~~p~~F~Yi~~~~~~~gv~~~~~~~~~~gC~C~~-~C~~~   61 (98)
T smart00468        1 CLDISNGKENVPVPLVNEVDED------------------PPPPDFEYISEYIYGQGVPIDRSPSPLVGCSCSG-DCSSS   61 (98)
T ss_pred             CccccCCccCCCcceEecCCCC------------------CCCCCcEECcceEcCCCcccccCCCCCCCCcCCC-CCCCC
Confidence            3699999999999999999963                  23379999999999888753 3466789999997 78887


Q ss_pred             C-CCcccccccccccccccCCCCcCCCcccCCCCceeecCCceEEecCCCCC
Q 000417         1313 T-CDHVYLFDNDYEDAKDIDGKSVHGRFPYDQTGRVILEEGYLIYECNHMCS 1363 (1534)
Q Consensus      1313 ~-C~C~~l~~~~y~~~~~i~g~~~~g~~~Yd~~G~l~~~~~~~IyECn~~C~ 1363 (1534)
                      . |.|+.+               .++.|+|+..+++++..+.+|||||+.|+
T Consensus        62 ~~C~C~~~---------------~~~~~~Y~~~~~~~~~~~~~IyECn~~C~   98 (98)
T smart00468       62 NKCECARK---------------NGGEFAYELNGGLRLKRKPLIYECNSRCS   98 (98)
T ss_pred             CcCCcHhh---------------cCCccCcccCCCEEeCCCCEEEcCCCCCC
Confidence            6 999643               24678997777778888999999999985


No 18 
>COG2940 Proteins containing SET domain [General function prediction only]
Probab=99.55  E-value=1e-15  Score=188.98  Aligned_cols=164  Identities=33%  Similarity=0.476  Sum_probs=132.7

Q ss_pred             EEecCCCCCCCCCCCCcccccCceeeEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhccccCCCcceEE
Q 000417         1355 IYECNHMCSCDRTCPNRVLQNGVRVKLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRSRYGRDGCGYML 1434 (1534)
Q Consensus      1355 IyECn~~C~C~~~C~NRvvQ~g~~~~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~~y~~~~~sYlf 1434 (1534)
                      +.+++..+.....+.|............+..+..+||||||.+.|++|++|.+|.|+++...++..+...+...+..+.|
T Consensus       308 ~~~~~s~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~g~fa~~~i~~~e~i~~~~~~~~~~~~~~~~~~~~~~~~~~~~~  387 (480)
T COG2940         308 SDFSKSNVSKLKELLNSNGCKKRREPNVVQESEIKGYGVFALESIKKGEFIIEYHGEIIRRKEAREREENYDLLGNEFSF  387 (480)
T ss_pred             cccccccCccccchhhhcccccccchhhhhhhcccccceeehhhccchHHHHHhcCcccchHHHHhhhccccccccccch
Confidence            33445555555567777777777888888899999999999999999999999999999999998888766444433333


Q ss_pred             ecCcccccccccccCceeEEEeccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCC
Q 000417         1435 NIGAHINDMGRLIEGQVRYVIDATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYEL 1514 (1534)
Q Consensus      1435 ~ld~~~~d~~~l~~~~~~~~IDA~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~ 1514 (1534)
                      ....           ....++|+...|+++|||||||.||+.+....+.    +..++.++|+|||.+|||||+||+..+
T Consensus       388 ~~~~-----------~~~~~~d~~~~g~~~r~~nHS~~pN~~~~~~~~~----g~~~~~~~~~rDI~~geEl~~dy~~~~  452 (480)
T COG2940         388 GLLE-----------DKDKVRDSQKAGDVARFINHSCTPNCEASPIEVN----GIFKISIYAIRDIKAGEELTYDYGPSL  452 (480)
T ss_pred             hhcc-----------ccchhhhhhhcccccceeecCCCCCcceeccccc----ccceeeecccccchhhhhhcccccccc
Confidence            3222           1267899999999999999999999999877665    367899999999999999999999887


Q ss_pred             CCCC--------CceeeCCCCCCcccc
Q 000417         1515 LSGE--------GYPCHCGASKCRGRL 1533 (1534)
Q Consensus      1515 ~~~~--------~~~C~CGS~~CRG~l 1533 (1534)
                      +...        ...|.||+..|+++|
T Consensus       453 ~~~~~~~~~~~~~~~~~~~~~~~~~~~  479 (480)
T COG2940         453 EDNRELKKLLEKRWGCACGEDRCSHTM  479 (480)
T ss_pred             ccchhhhhhhhhhhccccCCCccCCCC
Confidence            6422        578999999999987


No 19 
>KOG3576 consensus Ovo and related transcription factors [Transcription]
Probab=99.31  E-value=3.2e-13  Score=143.50  Aligned_cols=85  Identities=24%  Similarity=0.489  Sum_probs=51.3

Q ss_pred             CCCcccCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcccccccccccccccccCCC
Q 000417          844 DEKTHKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGS  923 (1534)
Q Consensus       844 gekpykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK  923 (1534)
                      +...|.|.+|+|.|....-|.+| ++.|...     +.|-|..|||.|...-.|++|+++|++.      +||+|..|+|
T Consensus       114 d~d~ftCrvCgK~F~lQRmlnrh-~kch~~v-----kr~lct~cgkgfndtfdlkrh~rthtgv------rpykc~~c~k  181 (267)
T KOG3576|consen  114 DQDSFTCRVCGKKFGLQRMLNRH-LKCHSDV-----KRHLCTFCGKGFNDTFDLKRHTRTHTGV------RPYKCSLCEK  181 (267)
T ss_pred             CCCeeeeehhhhhhhHHHHHHHH-hhhccHH-----HHHHHhhccCcccchhhhhhhhccccCc------cccchhhhhH
Confidence            34456666666666666666666 5566555     5566666666666666666666666655      5556666666


Q ss_pred             ccCChHHHhhhhhcccc
Q 000417          924 HFGNTEELWLHVQSVHA  940 (1534)
Q Consensus       924 ~Fssk~~Lk~H~~rvH~  940 (1534)
                      .|+.+..|..|.+++|.
T Consensus       182 aftqrcsleshl~kvhg  198 (267)
T KOG3576|consen  182 AFTQRCSLESHLKKVHG  198 (267)
T ss_pred             HHHhhccHHHHHHHHcC
Confidence            66666666666555553


No 20 
>PF00856 SET:  SET domain;  InterPro: IPR001214 The SET domain appears generally as one part of a larger multidomain protein, and recently there were described three structures of very different proteins with distinct domain compositions: Neurospora crassa DIM-5, a member of the Su(var) family of HKMTs which methylate histone H3 on lysine 9,human SET7 (also called SET9), which methylates H3 on lysine 4 and garden pea Rubisco LSMT, an enzyme that does not modify histones, but instead methylates lysine 14 in the flexible tail of the large subunit of the enzyme Rubisco. The SET domain itself turned out to be an uncommon structure. Although in all three studies, electron density maps revealed the location of the AdoMet or AdoHcy cofactor, the SET domain bears no similarity at all to the canonical/AdoMet-dependent methyltransferase fold. Strictly conserved in the C-terminal motif of the SET domain tyrosine could be involved in abstracting a proton from the protonated amino group of the substrate lysine, promoting its nucleophilic attack on the sulphonium methyl group of the AdoMet cofactor. In contrast to the AdoMet-dependent protein methyltranferases of the classical type, which tend to bind their polypeptide substrates on top of the cofactor, it is noted from the Rubisco LSMT structure that the AdoMet seems to bind in a separate cleft, suggesting how a polypeptide substrate could be subjected to multiple rounds of methylation without having to be released from the enzyme. In contrast, SET7/9 is able to add only a single methyl group to its substrate. It has been demonstrated that association of SET domain and myotubularin-related proteins modulates growth control []. The SET domain-containing Drosophila melanogaster (Fruit fly) protein, enhancer of zeste, has a function in segment determination and the mammalian homologue may be involved in the regulation of gene transcription and chromatin structure. Histone lysine methylation is part of the histone code that regulated chromatin function and epigenetic control of gene function. Histone lysine methyltransferases (HMTase) differ both in their substrate specificity for the various acceptor lysines as well as in their product specificity for the number of methyl groups (one, two, or three) they transfer. With just one exception [], the HMTases belong to SET family that can be classified according to the sequences surrounding the SET domain [, ]. Structural studies on the human SET7/9, a mono-methylase, have revealed the molecular basis for the specificity of the enzyme for the histone-target and the roles of the invariant residues in the SET domain in determining the methylation specificities [].  The pre-SET domain, as found in the SUV39 SET family, contains nine invariant cysteine residues that are grouped into two segments separated by a region of variable length. These 9 cysteines coordinate 3 zinc ions to form to form a triangular cluster, where each of the zinc ions is coordinated by 4 four cysteines to give a tetrahedral configuration. The function of this domain is structural, holding together 2 long segments of random coils. The C-terminal region including the post-SET domain is disordered when not interacting with a histone tail and in the absence of zinc. The three conserved cysteines in the post-SET domain form a zinc-binding site when coupled to a fourth conserved cysteine in the knot-like structure close to the SET domain active site []. The structured post-SET region brings in the C-terminal residues that participate in S-adenosylmethine-binding and histone tail interactions. The three conserved cysteine residues are essential for HMTase activity, as replacement with serine abolishes HMTase activity [], []. ; GO: 0005515 protein binding; PDB: 3TG5_A 3S7F_A 3RIB_B 3TG4_A 3S7J_A 3S7D_A 3S7B_A 3H6L_A 3SMT_A 3K5K_A ....
Probab=99.29  E-value=1.8e-12  Score=133.61  Aligned_cols=118  Identities=18%  Similarity=0.087  Sum_probs=73.6

Q ss_pred             CccccccccccCCCeEEEeeeEeecHHHHHHHh---ccc--cCCCcceE--E----------------------------
Q 000417         1390 GWAVRAGQAILRGTFVCEYIGEVLDELETNKRR---SRY--GRDGCGYM--L---------------------------- 1434 (1534)
Q Consensus      1390 GwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~---~~y--~~~~~sYl--f---------------------------- 1434 (1534)
                      |+||+|+++|++|++|+++.+.+++...+....   ...  ........  +                            
T Consensus         1 GrGl~At~dI~~Ge~I~~p~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~   80 (162)
T PF00856_consen    1 GRGLFATRDIKAGEVILIPRPAILTPDEVSPQPELLRLQLSKALEEQSRSDFSIQKKQKAEKSERSPQLESLHSISLRSE   80 (162)
T ss_dssp             SEEEEESS-B-TTEEEEEESEEEEEHHHHHCHHHHSHHTTCSSSCSHHTTHHHHHHHHHHHHHHHHHHHHHHHHHCHTTT
T ss_pred             CEEEEECccCCCCCEEEEECcceEEehhhhhcccchhhhhhhhhcccccccccccccccccccccccccccccccccccc
Confidence            899999999999999999999999987775420   000  00000000  0                            


Q ss_pred             -ecCcc-c--c-----cccccccCceeEEEeccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCe
Q 000417         1435 -NIGAH-I--N-----DMGRLIEGQVRYVIDATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEE 1505 (1534)
Q Consensus      1435 -~ld~~-~--~-----d~~~l~~~~~~~~IDA~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEE 1505 (1534)
                       ..... .  .     ..............++.....++.||||||.|||.+......    ....+.|.|.|||++|||
T Consensus        81 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~p~~d~~NHsc~pn~~~~~~~~~----~~~~~~~~a~r~I~~GeE  156 (162)
T PF00856_consen   81 LQFSQAFQWSWFISWTRSDFSSRSFSEDDRDGIALYPFADMLNHSCDPNCEVSFDFDG----DGGCLVVRATRDIKKGEE  156 (162)
T ss_dssp             CCTCCHHHHHHHHHHHHHEEEEEEETTEEEEEEEEETGGGGSEEESSTSEEEEEEEET----TTTEEEEEESS-B-TTSB
T ss_pred             ccccccccchhhccccceeeeccccccccccccccCcHhHheccccccccceeeEeec----ccceEEEEECCccCCCCE
Confidence             00000 0  0     000000011224456677788999999999999998776543    567899999999999999


Q ss_pred             EEEEcC
Q 000417         1506 LTYDYH 1511 (1534)
Q Consensus      1506 LT~DYg 1511 (1534)
                      ||++||
T Consensus       157 i~isYG  162 (162)
T PF00856_consen  157 IFISYG  162 (162)
T ss_dssp             EEEEST
T ss_pred             EEEEEC
Confidence            999998


No 21 
>KOG3576 consensus Ovo and related transcription factors [Transcription]
Probab=99.28  E-value=1.7e-12  Score=138.04  Aligned_cols=121  Identities=17%  Similarity=0.304  Sum_probs=106.9

Q ss_pred             CccccCccCcccCChHHHHhHhhhcccccccccccccccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCC
Q 000417          880 RGYACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGED  959 (1534)
Q Consensus       880 kpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geK  959 (1534)
                      ..|.|.+|+|.|.-...|.+|++.|...      +.|-|..|||.|.....|++|                         
T Consensus       116 d~ftCrvCgK~F~lQRmlnrh~kch~~v------kr~lct~cgkgfndtfdlkrh-------------------------  164 (267)
T KOG3576|consen  116 DSFTCRVCGKKFGLQRMLNRHLKCHSDV------KRHLCTFCGKGFNDTFDLKRH-------------------------  164 (267)
T ss_pred             CeeeeehhhhhhhHHHHHHHHhhhccHH------HHHHHhhccCcccchhhhhhh-------------------------
Confidence            5699999999999999999999999887      667899999999998888777                         


Q ss_pred             CCccccCCCchhhhhhhhhcCCcceeeecccCCccCChhHHHHHHHhhccCCCC-----CCCCCcccCCCCcccCCchhh
Q 000417          960 SPKKLELGYSASVENHSENLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNL-----VNSRPHKKGIRFYAYKLKSGR 1034 (1534)
Q Consensus       960 p~~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~-----~~eKpYkC~iC~K~F~sks~L 1034 (1534)
                                      +|+|+|.+||+|..|+|+|.++-.|..|..++|.-...     ...|.|.|+.||++-.....+
T Consensus       165 ----------------~rthtgvrpykc~~c~kaftqrcsleshl~kvhgv~~~yaykerr~kl~vcedcg~t~~~~e~~  228 (267)
T KOG3576|consen  165 ----------------TRTHTGVRPYKCSLCEKAFTQRCSLESHLKKVHGVQHQYAYKERRAKLYVCEDCGYTSERPEVY  228 (267)
T ss_pred             ----------------hccccCccccchhhhhHHHHhhccHHHHHHHHcCchHHHHHHHhhhheeeecccCCCCCChhHH
Confidence                            56788999999999999999999999988899976432     226789999999999999999


Q ss_pred             hcccccccCCCCc
Q 000417         1035 LSRPRFKKGLGAV 1047 (1534)
Q Consensus      1035 ~rH~r~H~gekpy 1047 (1534)
                      ..|++.|+...|+
T Consensus       229 ~~h~~~~hp~Spa  241 (267)
T KOG3576|consen  229 YLHLKLHHPFSPA  241 (267)
T ss_pred             HHHHHhcCCCCHH
Confidence            9999999887553


No 22 
>KOG3623 consensus Homeobox transcription factor SIP1 [Transcription]
Probab=99.18  E-value=5.4e-12  Score=152.73  Aligned_cols=125  Identities=22%  Similarity=0.347  Sum_probs=85.4

Q ss_pred             cccCccCcccCChHHHHhHhhhcccccccccccccccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCCCC
Q 000417          882 YACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSP  961 (1534)
Q Consensus       882 ykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~  961 (1534)
                      ..|++|.+.+..-..|+.|++..|...+    -.|.|..|..+|..+..|.+| +..|...      +..          
T Consensus       211 ltcpycdrgykrltslkeHikyrhekne----~nfsC~lCsytFAyRtQLErh-m~~hkpg------~dq----------  269 (1007)
T KOG3623|consen  211 LTCPYCDRGYKRLTSLKEHIKYRHEKNE----PNFSCMLCSYTFAYRTQLERH-MQLHKPG------GDQ----------  269 (1007)
T ss_pred             hcchhHHHHHHHHHHHHHHHHHHHhhCC----CCCcchhhhhhhhhHHHHHHH-HHhhcCC------Ccc----------
Confidence            4566666666666666666655444322    235566666666666666666 4455310      000          


Q ss_pred             ccccCCCchhhhhhhhhcCCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccc
Q 000417          962 KKLELGYSASVENHSENLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFK 1041 (1534)
Q Consensus       962 ~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H 1041 (1534)
                                 ..|+-.-...+.|+|..|||.|+.+.+|+. |.|+|.|     +|||.|+-|+|+|+...++..||...
T Consensus       270 -----------a~sltqsa~lRKFKCtECgKAFKfKHHLKE-HlRIHSG-----EKPfeCpnCkKRFSHSGSySSHmSSK  332 (1007)
T KOG3623|consen  270 -----------AISLTQSALLRKFKCTECGKAFKFKHHLKE-HLRIHSG-----EKPFECPNCKKRFSHSGSYSSHMSSK  332 (1007)
T ss_pred             -----------cccccchhhhccccccccchhhhhHHHHHh-hheeecC-----CCCcCCcccccccccCCccccccccc
Confidence                       011111223478999999999999999999 8999999     99999999999999999999999666


Q ss_pred             cCC
Q 000417         1042 KGL 1044 (1534)
Q Consensus      1042 ~ge 1044 (1534)
                      +..
T Consensus       333 KCI  335 (1007)
T KOG3623|consen  333 KCI  335 (1007)
T ss_pred             chh
Confidence            543


No 23 
>PLN03086 PRLI-interacting factor K; Provisional
Probab=98.76  E-value=6.3e-09  Score=128.72  Aligned_cols=139  Identities=17%  Similarity=0.163  Sum_probs=102.3

Q ss_pred             cccCccCcccCChHHHHhHhhhccccccccccccccccc--CCCccCChHHHhhhhhccccCcccchhhhhhcccccCCC
Q 000417          882 YACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIP--CGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGED  959 (1534)
Q Consensus       882 ykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~--CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geK  959 (1534)
                      -.|+.|..... ...|..|......       ..-.|+.  |+..| .+..+..|                         
T Consensus       408 V~C~NC~~~i~-l~~l~lHe~~C~r-------~~V~Cp~~~Cg~v~-~r~el~~H-------------------------  453 (567)
T PLN03086        408 VECRNCKHYIP-SRSIALHEAYCSR-------HNVVCPHDGCGIVL-RVEEAKNH-------------------------  453 (567)
T ss_pred             EECCCCCCccc-hhHHHHHHhhCCC-------cceeCCccccccee-eccccccC-------------------------
Confidence            46999987655 4556677643222       1234874  88888 34455555                         


Q ss_pred             CCccccCCCch---hhhhhhhhcCCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCC------
Q 000417          960 SPKKLELGYSA---SVENHSENLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKL------ 1030 (1534)
Q Consensus       960 p~~C~~Cgk~~---sLk~HlrtHtgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~s------ 1030 (1534)
                       +.|..|+..+   .|..|+++|+  +++.|+ ||+.| .+..|.. |+++|..     .+++.|.+|++.|..      
T Consensus       454 -~~C~~Cgk~f~~s~LekH~~~~H--kpv~Cp-Cg~~~-~R~~L~~-H~~thCp-----~Kpi~C~fC~~~v~~g~~~~d  522 (567)
T PLN03086        454 -VHCEKCGQAFQQGEMEKHMKVFH--EPLQCP-CGVVL-EKEQMVQ-HQASTCP-----LRLITCRFCGDMVQAGGSAMD  522 (567)
T ss_pred             -ccCCCCCCccchHHHHHHHHhcC--CCccCC-CCCCc-chhHHHh-hhhccCC-----CCceeCCCCCCccccCccccc
Confidence             3455555333   5899999985  899999 99765 6789998 7899999     899999999999952      


Q ss_pred             ----chhhhcccccccCCCCccCCCCCCcCCChHHHHhhcc
Q 000417         1031 ----KSGRLSRPRFKKGLGAVSYRIRNRGAAGMKKRIQTLK 1067 (1534)
Q Consensus      1031 ----ks~L~rH~r~H~gekpy~C~iCgksFs~~~~L~kH~K 1067 (1534)
                          .+.|..|..++ |.+++.|..||+.+. ++.+..|+.
T Consensus       523 ~~d~~s~Lt~HE~~C-G~rt~~C~~Cgk~Vr-lrdm~~H~~  561 (567)
T PLN03086        523 VRDRLRGMSEHESIC-GSRTAPCDSCGRSVM-LKEMDIHQI  561 (567)
T ss_pred             hhhhhhhHHHHHHhc-CCcceEccccCCeee-ehhHHHHHH
Confidence                45899999886 999999999998875 445556654


No 24 
>KOG1081 consensus Transcription factor NSD1 and related SET domain proteins [Transcription]
Probab=98.70  E-value=4.5e-09  Score=128.97  Aligned_cols=145  Identities=35%  Similarity=0.609  Sum_probs=108.4

Q ss_pred             EEec-CCCCCCCCCCCCcccccCceeeEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhccccCCC--cc
Q 000417         1355 IYEC-NHMCSCDRTCPNRVLQNGVRVKLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRSRYGRDG--CG 1431 (1534)
Q Consensus      1355 IyEC-n~~C~C~~~C~NRvvQ~g~~~~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~~y~~~~--~s 1431 (1534)
                      .+|| +..|.+...|.|+-........      +..    +|..+|.+|      +|++++..+...|........  ..
T Consensus       289 ~~~~~p~~~~~~~~~~~~~~sk~~~~e------~~~----~~~~~~~k~------vg~~i~~~e~~~~~~~~~~~~~~~~  352 (463)
T KOG1081|consen  289 AYEVHPKVCSAEERCHNQQFSKESYPE------PQK----TAKADIRKG------VGEVIDDKECKARLQRVKESDLVDF  352 (463)
T ss_pred             hhhhcccccccccccccchhhhhcccc------cch----hhHHhhhcc------cCcccchhhheeehhhhhccchhhh
Confidence            3444 5788888889888654433333      222    899999999      999999988776553322211  11


Q ss_pred             eEEecCcccccccccccCceeEEEeccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcC
Q 000417         1432 YMLNIGAHINDMGRLIEGQVRYVIDATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYH 1511 (1534)
Q Consensus      1432 Ylf~ld~~~~d~~~l~~~~~~~~IDA~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg 1511 (1534)
                      |+..+..             ...||+..+||.+||+||||+||+..+.+.+.    +..++++||.++|++||||||+|.
T Consensus       353 ~~~~~e~-------------~~~id~~~~~n~sr~~nh~~~~~v~~~k~~~~----~~t~~~~~a~~~i~~g~e~t~~~n  415 (463)
T KOG1081|consen  353 YMVFIQK-------------DRIIDAGPKGNYSRFLNHSCQPNVETEKWQVI----GDTRVGLFAPRQIEAGEELTFNYN  415 (463)
T ss_pred             hhhhhhc-------------ccccccccccchhhhhcccCCCceeechhhee----cccccccccccccccchhhhheee
Confidence            2111111             22899999999999999999999999888777    778899999999999999999998


Q ss_pred             CCCCCCCCceeeCCCCCCcccc
Q 000417         1512 YELLSGEGYPCHCGASKCRGRL 1533 (1534)
Q Consensus      1512 ~~~~~~~~~~C~CGS~~CRG~l 1533 (1534)
                      ..-. +....|.||+.+|.+.+
T Consensus       416 ~~~~-~~~~~~~~~~e~~~~~~  436 (463)
T KOG1081|consen  416 GNCE-GNEKRCCCGSENCTETK  436 (463)
T ss_pred             cccc-CCcceEeecccccccCC
Confidence            7642 34689999999998864


No 25 
>PLN03086 PRLI-interacting factor K; Provisional
Probab=98.69  E-value=1.3e-08  Score=126.12  Aligned_cols=143  Identities=20%  Similarity=0.325  Sum_probs=100.6

Q ss_pred             CcccCCCCCcccCChhhHhhhhhcccCccccccCCccccCc--cCcccCChHHHHhHhhhcccccccccccccccccCCC
Q 000417          846 KTHKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAI--CLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGS  923 (1534)
Q Consensus       846 kpykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~--CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK  923 (1534)
                      ..-.|+.|...... ..|..| .... ..     ..-.|+.  |+..|. +..+..|               +.|+.|++
T Consensus       406 ~~V~C~NC~~~i~l-~~l~lH-e~~C-~r-----~~V~Cp~~~Cg~v~~-r~el~~H---------------~~C~~Cgk  461 (567)
T PLN03086        406 DTVECRNCKHYIPS-RSIALH-EAYC-SR-----HNVVCPHDGCGIVLR-VEEAKNH---------------VHCEKCGQ  461 (567)
T ss_pred             CeEECCCCCCccch-hHHHHH-HhhC-CC-----cceeCCcccccceee-ccccccC---------------ccCCCCCC
Confidence            34579999887765 456688 3332 22     3456885  999883 4445555               24999999


Q ss_pred             ccCChHHHhhhhhccccCcccchhhhhhcccccCCCCCccccCCCchhhhhhhhhcCCcceeeecccCCccC--------
Q 000417          924 HFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSPKKLELGYSASVENHSENLGSIRKFICRFCGLKFD--------  995 (1534)
Q Consensus       924 ~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKsF~--------  995 (1534)
                      .|. ...|..|+ ..|...+.|+ |++.+               .+..|..|+++|.+.+++.|++|++.|.        
T Consensus       462 ~f~-~s~LekH~-~~~Hkpv~Cp-Cg~~~---------------~R~~L~~H~~thCp~Kpi~C~fC~~~v~~g~~~~d~  523 (567)
T PLN03086        462 AFQ-QGEMEKHM-KVFHEPLQCP-CGVVL---------------EKEQMVQHQASTCPLRLITCRFCGDMVQAGGSAMDV  523 (567)
T ss_pred             ccc-hHHHHHHH-HhcCCCccCC-CCCCc---------------chhHHHhhhhccCCCCceeCCCCCCccccCccccch
Confidence            996 67899994 4442334443 33211               1246889999999999999999999995        


Q ss_pred             --ChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhccc
Q 000417          996 --LLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRP 1038 (1534)
Q Consensus       996 --sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~ 1038 (1534)
                        ..+.|.. |..++ |     .+++.|..|++.|..+ .|..|+
T Consensus       524 ~d~~s~Lt~-HE~~C-G-----~rt~~C~~Cgk~Vrlr-dm~~H~  560 (567)
T PLN03086        524 RDRLRGMSE-HESIC-G-----SRTAPCDSCGRSVMLK-EMDIHQ  560 (567)
T ss_pred             hhhhhhHHH-HHHhc-C-----CcceEccccCCeeeeh-hHHHHH
Confidence              2458888 67775 6     7899999999988765 667777


No 26 
>PHA00733 hypothetical protein
Probab=98.64  E-value=1.5e-08  Score=104.61  Aligned_cols=87  Identities=10%  Similarity=0.050  Sum_probs=70.4

Q ss_pred             cccccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCCCCccccCCCchhhhhhhhhcCCcceeeecccCCc
Q 000417          914 MLQQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSPKKLELGYSASVENHSENLGSIRKFICRFCGLK  993 (1534)
Q Consensus       914 kpykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKs  993 (1534)
                      +++.|.+|.+.|.+...|..|                                   ..|.+|+..| +.+||.|+.||+.
T Consensus        39 ~~~~~~~~~~~~~~~~~l~~~-----------------------------------~~l~~~~~~~-~~kPy~C~~Cgk~   82 (128)
T PHA00733         39 KRLIRAVVKTLIYNPQLLDES-----------------------------------SYLYKLLTSK-AVSPYVCPLCLMP   82 (128)
T ss_pred             hhHHHHHHhhhccChhhhcch-----------------------------------HHHHhhcccC-CCCCccCCCCCCc
Confidence            678899999888888777776                                   2355665444 4789999999999


Q ss_pred             cCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccccCC
Q 000417          994 FDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGL 1044 (1534)
Q Consensus       994 F~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~ge 1044 (1534)
                      |.+...|.. |++.|+.       +|.|+.|++.|.....|.+|++.+++.
T Consensus        83 Fss~s~L~~-H~r~h~~-------~~~C~~CgK~F~~~~sL~~H~~~~h~~  125 (128)
T PHA00733         83 FSSSVSLKQ-HIRYTEH-------SKVCPVCGKEFRNTDSTLDHVCKKHNI  125 (128)
T ss_pred             CCCHHHHHH-HHhcCCc-------CccCCCCCCccCCHHHHHHHHHHhcCc
Confidence            999999999 7777743       689999999999999999999777653


No 27 
>KOG2589 consensus Histone tail methylase [Chromatin structure and dynamics]
Probab=98.64  E-value=1.8e-08  Score=115.77  Aligned_cols=117  Identities=23%  Similarity=0.309  Sum_probs=88.5

Q ss_pred             CCCCccccccccccCCCeEEEeeeEeecHHHHHHHhc-cccCCCcceEEecCcccccccccccCceeEEEeccccCCccc
Q 000417         1387 ENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRS-RYGRDGCGYMLNIGAHINDMGRLIEGQVRYVIDATKYGNVSR 1465 (1534)
Q Consensus      1387 ~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~-~y~~~~~sYlf~ld~~~~d~~~l~~~~~~~~IDA~~~GNvaR 1465 (1534)
                      ...|--|.+++.+.+|+=|--.+|-|+.-.+++++.- +.+..+-+-+|.....                .|..+-..|+
T Consensus       135 ~~~gAkivst~~w~~ndkIe~LvGcIaeLse~eE~~ll~~g~nDFSvmyStRk~----------------caqLwLGPaa  198 (453)
T KOG2589|consen  135 SQNGAKIVSTKSWSRNDKIELLVGCIAELSEAEERSLLRGGGNDFSVMYSTRKR----------------CAQLWLGPAA  198 (453)
T ss_pred             cCCCceEEeeccccCCccHHHhhhhhhhcChhhhHHHHhccCCceeeeeecccc----------------hhhheeccHH
Confidence            3567788999999999999999999988777777642 2222333344433221                1222334689


Q ss_pred             ccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCCCCCCCceeeCCC
Q 000417         1466 FINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYELLSGEGYPCHCGA 1526 (1534)
Q Consensus      1466 FINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~~~~~~~~C~CGS 1526 (1534)
                      ||||-|.|||.+...       +..++.+-++|||+||||||--||.+|+......|.|-+
T Consensus       199 fINHDCrpnCkFvs~-------g~~tacvkvlRDIePGeEITcFYgs~fFG~~N~~CeC~T  252 (453)
T KOG2589|consen  199 FINHDCRPNCKFVST-------GRDTACVKVLRDIEPGEEITCFYGSGFFGENNEECECVT  252 (453)
T ss_pred             hhcCCCCCCceeecC-------CCceeeeehhhcCCCCceeEEeecccccCCCCceeEEee
Confidence            999999999998442       456789999999999999999999999988888898875


No 28 
>KOG1141 consensus Predicted histone methyl transferase [Chromatin structure and dynamics]
Probab=98.46  E-value=1.5e-07  Score=115.98  Aligned_cols=286  Identities=30%  Similarity=0.543  Sum_probs=191.3

Q ss_pred             CCCceeeecCCCCCCCCCeeEeeCCCCcccccccCCCCCcccccCCCCCCCcEEeccCCCCCCCCCcccCCCCCcccCCC
Q 000417         1228 LRGTVLCDDISSGLESVPVACVVDDGLLETLCISADSSDSQKTRCSMPWESFTYVTKPLLDQSLDLDAESLQLGCACANS 1307 (1534)
Q Consensus      1228 ~~~~~i~~DIS~G~E~vPV~~vnd~D~~~~~~~~g~~~~~~~~~~~~P~~~F~Yi~~~~~~~~~~~d~e~~~~GC~C~~~ 1307 (1534)
                      ...++-..|.+.|.+.+|||.||.+|...++.-+    ++.        ..|.|.-+.... +   ....+..||.|.. 
T Consensus       871 D~~g~d~~d~~~g~sg~~~p~~~~~d~~~~~~c~----d~~--------~~~~~~~~~~~s-~---~~~~~~~~~s~d~-  933 (1262)
T KOG1141|consen  871 DDKGLDVADFSLGTSGIPIPLVNSVDNDEPPSCE----DSK--------RRFQYNDQVDIS-S---VSRDFCSGCSCDG-  933 (1262)
T ss_pred             cccccchhhhhccccCCCCccccccccCCCcccc----ccc--------eeecccccchhh-h---hccccccccccCC-
Confidence            3455667899999999999999988864322111    111        134443321111 1   2345778999975 


Q ss_pred             CcC-CCCCCcccccccccccccc---cCCCCcCCCcccCCCCceeecCCceEEecCCCCCCCCCCCCcccccCceeeE--
Q 000417         1308 TCF-PETCDHVYLFDNDYEDAKD---IDGKSVHGRFPYDQTGRVILEEGYLIYECNHMCSCDRTCPNRVLQNGVRVKL-- 1381 (1534)
Q Consensus      1308 ~C~-p~~C~C~~l~~~~y~~~~~---i~g~~~~g~~~Yd~~G~l~~~~~~~IyECn~~C~C~~~C~NRvvQ~g~~~~L-- 1381 (1534)
                      .|. -+.|.|.++.-........   ..|...--.-+|+.+..+    ...+|||++.|.|...|.||++|++.+++.  
T Consensus       934 hp~d~~~~~~~~~~~~~~~~cpp~~s~d~~~~~~eS~~~~ns~~----~~~f~e~~~hss~~~~e~~~~v~~~~~~~me~ 1009 (1262)
T KOG1141|consen  934 HPSDASKCECQQLSIEAMKRCPPNLSFDGHDELYESSEKQNSFL----KLFFFECNDHSSCHRKEYNRVVQNNIKYPMEV 1009 (1262)
T ss_pred             CCcccCcccCCCCChhhhcCCCCccccCchhhhhhhhhhcchhh----hccceeccccchhcccccchhhhcCCccceee
Confidence            453 3678886543221111000   000000000112222211    235789999999999999999999988775  


Q ss_pred             ------EEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhc----cccCC----------------CcceEEe
Q 000417         1382 ------EVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRS----RYGRD----------------GCGYMLN 1435 (1534)
Q Consensus      1382 ------eVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~----~y~~~----------------~~sYlf~ 1435 (1534)
                            .||++...|||+++..||+.-+|||+|+|...++.-+.+-..    .|...                ..+|--+
T Consensus      1010 ~s~~~l~i~~~~~~~~~~~edtD~~~~~~~~~~~~~ppt~~l~~~~r~aqad~~sn~~D~~~~~~l~es~~~~~T~~r~~ 1089 (1262)
T KOG1141|consen 1010 SSFNDLQIFKTAQSGWGVREDTDIPQSTFICTYVGAPPTDDLADELRNAQADQYSNDLDLKDTVELEESREDHETDFRGD 1089 (1262)
T ss_pred             eecccccccccccccccccccccCCCCcccccccCCCCchhhHHHHhhhhhccccCccchhhhhhhhhcccccccccCCC
Confidence                  466777899999999999999999999999988766554221    11100                0000000


Q ss_pred             c---------Cccc----------cc----------ccc-----------------------------------------
Q 000417         1436 I---------GAHI----------ND----------MGR----------------------------------------- 1445 (1534)
Q Consensus      1436 l---------d~~~----------~d----------~~~----------------------------------------- 1445 (1534)
                      .         +...          .+          +.|                                         
T Consensus      1090 t~~~~~~~~~d~dd~q~I~k~ve~qd~~~~~~~T~~~~RQ~~~~s~k~~~~~s~~~~~~ts~~~~~~dkges~~~~~~~~ 1169 (1262)
T KOG1141|consen 1090 TSDYDDEEGSDGDDGQDIMKMVERQDSSESGEETKRLTRQKRKQSKKSGKGGSVEKDDTTSRDSMEKDKGESKDEPVFNW 1169 (1262)
T ss_pred             CCCCcccccccCccHHHHHHHhhcccccccccccchhhhhhhhhhhhcccCccccccccCccchhhhccCccCcccccch
Confidence            0         0000          00          000                                         


Q ss_pred             --cccCceeEEEeccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCC--CCCCCce
Q 000417         1446 --LIEGQVRYVIDATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYEL--LSGEGYP 1521 (1534)
Q Consensus      1446 --l~~~~~~~~IDA~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~--~~~~~~~ 1521 (1534)
                        ..+...-|+|||+.-||++||+||||.||+.+|+|+++++|.++|++||||.|-|+||+||||||+|..  ...+...
T Consensus      1170 ~~y~~~~~~yvIDAk~eGNlGRfLNHSC~PNl~VQnVfvdTHdlrfPwVAFFt~kyVkAgtELTWDY~Ye~g~v~~keL~ 1249 (1262)
T KOG1141|consen 1170 DKYFEPFPLYVIDAKQEGNLGRFLNHSCDPNLHVQNVFVDTHDLRFPWVAFFTRKYVKAGTELTWDYQYEQGQVATKELT 1249 (1262)
T ss_pred             hhccCCCceEEEecccccchhhhhccCCCccceeeeeeeeccccCCchhhhhhhhhhccCceeeeeccccccccccceEE
Confidence              001125699999999999999999999999999999999999999999999999999999999999986  4566889


Q ss_pred             eeCCCCCCccccC
Q 000417         1522 CHCGASKCRGRLY 1534 (1534)
Q Consensus      1522 C~CGS~~CRG~l~ 1534 (1534)
                      |+||+.+|||+|+
T Consensus      1250 C~CGa~~CrgrLL 1262 (1262)
T KOG1141|consen 1250 CHCGAENCRGRLL 1262 (1262)
T ss_pred             EecChhhhhcccC
Confidence            9999999999996


No 29 
>PHA00733 hypothetical protein
Probab=98.30  E-value=3.1e-07  Score=94.98  Aligned_cols=81  Identities=5%  Similarity=-0.033  Sum_probs=67.7

Q ss_pred             CcceeeecccCCccCChhHHHHH-HHh---hccCCCCCCCCCcccCCCCcccCCchhhhcccccccCCCCccCCCCCCcC
Q 000417          981 SIRKFICRFCGLKFDLLPDLGRH-HQA---AHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRIRNRGA 1056 (1534)
Q Consensus       981 geKpykC~~CgKsF~sks~LkrH-H~r---tHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~iCgksF 1056 (1534)
                      ..+++.|.+|.+.|.....|..| ..+   .+.+     .+||.|+.|++.|.+...|..|++.|  ..+|.|..|++.|
T Consensus        37 ~~~~~~~~~~~~~~~~~~~l~~~~~l~~~~~~~~-----~kPy~C~~Cgk~Fss~s~L~~H~r~h--~~~~~C~~CgK~F  109 (128)
T PHA00733         37 EQKRLIRAVVKTLIYNPQLLDESSYLYKLLTSKA-----VSPYVCPLCLMPFSSSVSLKQHIRYT--EHSKVCPVCGKEF  109 (128)
T ss_pred             hhhhHHHHHHhhhccChhhhcchHHHHhhcccCC-----CCCccCCCCCCcCCCHHHHHHHHhcC--CcCccCCCCCCcc
Confidence            34789999999999988777764 022   2223     68999999999999999999999987  4579999999999


Q ss_pred             CChHHHHhhccc
Q 000417         1057 AGMKKRIQTLKP 1068 (1534)
Q Consensus      1057 s~~~~L~kH~Ks 1068 (1534)
                      .....|..|+..
T Consensus       110 ~~~~sL~~H~~~  121 (128)
T PHA00733        110 RNTDSTLDHVCK  121 (128)
T ss_pred             CCHHHHHHHHHH
Confidence            999999999863


No 30 
>KOG3993 consensus Transcription factor (contains Zn finger) [Transcription]
Probab=98.28  E-value=2.3e-07  Score=108.62  Aligned_cols=187  Identities=14%  Similarity=0.090  Sum_probs=113.6

Q ss_pred             cCCCcccCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcccccccc-----------
Q 000417          843 EDEKTHKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVE-----------  911 (1534)
Q Consensus       843 ~gekpykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~-----------  911 (1534)
                      +.-.-|.|.+|...|.+...|.+| +-.-.-.     --|+|++|+|.|....+|..|.|.|.......           
T Consensus       263 n~iGdyiCqLCK~kYeD~F~LAQH-rC~RIV~-----vEYrCPEC~KVFsCPANLASHRRWHKPR~eaa~a~~~P~k~~~  336 (500)
T KOG3993|consen  263 NVIGDYICQLCKEKYEDAFALAQH-RCPRIVH-----VEYRCPECDKVFSCPANLASHRRWHKPRPEAAKAGSPPPKQAV  336 (500)
T ss_pred             ccHHHHHHHHHHHhhhhHHHHhhc-cCCeeEE-----eeecCCcccccccCchhhhhhhcccCCchhhhhcCCCChhhhh
Confidence            334469999999999999999999 4332222     34999999999999999999999986442221           


Q ss_pred             ----------------cccccccccCCCccCChHHHhhhhhccccCcccchhhhhhcc-cccCCCCCccccCCCchhhh-
Q 000417          912 ----------------QCMLQQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHN-QSVGEDSPKKLELGYSASVE-  973 (1534)
Q Consensus       912 ----------------~~kpykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~-~~~geKp~~C~~Cgk~~sLk-  973 (1534)
                                      ....|.|.+|+|+|.....|+.| +..|...-.-..-.-.|. .....--+.|..|...+.+. 
T Consensus       337 ~~rae~~ea~rsg~dss~gi~~C~~C~KkFrRqAYLrKH-qlthq~~~~~k~~a~~f~~s~~~~l~~~~~~~a~h~~a~~  415 (500)
T KOG3993|consen  337 ETRAEVQEAERSGDDSSSGIFSCHTCGKKFRRQAYLRKH-QLTHQRAPLAKEKAPKFLLSRVIPLMHFNQAVATHSSASD  415 (500)
T ss_pred             hhhhhhhhccccCCcccCceeecHHhhhhhHHHHHHHHh-HHhhhccccchhcccCcchhhccccccccccccccccccc
Confidence                            11469999999999999999999 555532100000000011 10011112333333222111 


Q ss_pred             ---hhhhhcCC-cceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccc-ccc
Q 000417          974 ---NHSENLGS-IRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPR-FKK 1042 (1534)
Q Consensus       974 ---~HlrtHtg-eKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r-~H~ 1042 (1534)
                         .|..-+.+ ..-..|++||-.+.++..-.. +.+.-..     +..|.|.+|.-.|.+..+|.+|+. -|-
T Consensus       416 ~~g~~vl~~a~sael~~pp~~~~ppsss~~sgg-~~rlg~~-----~q~f~~ky~~atfyss~~ltrhin~~Hp  483 (500)
T KOG3993|consen  416 SHGDEVLYVAGSAELELPPYDGSPPSSSGSSGG-YGRLGIA-----EQGFTCKYCPATFYSSPGLTRHINKCHP  483 (500)
T ss_pred             ccccceeeeeccccccCCCCCCCCcccCCCCCc-cccccch-----hhccccccchHhhhcCcchHhHhhhcCh
Confidence               11111111 122457788877777665544 2222222     456888888888888888888884 443


No 31 
>PHA02768 hypothetical protein; Provisional
Probab=98.09  E-value=6.5e-07  Score=78.84  Aligned_cols=42  Identities=14%  Similarity=0.064  Sum_probs=22.6

Q ss_pred             eeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhh
Q 000417          985 FICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGR 1034 (1534)
Q Consensus       985 ykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L 1034 (1534)
                      |+|+.||+.|.+.++|.. |+++|+.       +|+|..|++.|.+.+.|
T Consensus         6 y~C~~CGK~Fs~~~~L~~-H~r~H~k-------~~kc~~C~k~f~~~s~l   47 (55)
T PHA02768          6 YECPICGEIYIKRKSMIT-HLRKHNT-------NLKLSNCKRISLRTGEY   47 (55)
T ss_pred             cCcchhCCeeccHHHHHH-HHHhcCC-------cccCCcccceeccccee
Confidence            555555555555555555 4555542       45555555555555444


No 32 
>PHA02768 hypothetical protein; Provisional
Probab=98.06  E-value=2e-06  Score=75.78  Aligned_cols=45  Identities=11%  Similarity=-0.033  Sum_probs=41.7

Q ss_pred             CcccCCCCcccCCchhhhcccccccCCCCccCCCCCCcCCChHHHHh
Q 000417         1018 PHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRIRNRGAAGMKKRIQ 1064 (1534)
Q Consensus      1018 pYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~iCgksFs~~~~L~k 1064 (1534)
                      .|+|+.||+.|.+.++|..|+++|+  ++|+|..|++.|.+.+.|+.
T Consensus         5 ~y~C~~CGK~Fs~~~~L~~H~r~H~--k~~kc~~C~k~f~~~s~l~~   49 (55)
T PHA02768          5 GYECPICGEIYIKRKSMITHLRKHN--TNLKLSNCKRISLRTGEYIE   49 (55)
T ss_pred             ccCcchhCCeeccHHHHHHHHHhcC--CcccCCcccceecccceeEE
Confidence            5899999999999999999999999  79999999999998887764


No 33 
>KOG3993 consensus Transcription factor (contains Zn finger) [Transcription]
Probab=98.03  E-value=2.1e-06  Score=100.78  Aligned_cols=171  Identities=18%  Similarity=0.219  Sum_probs=112.8

Q ss_pred             ccccCccCcccCChHHHHhHhhhcccccccccccccccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCCC
Q 000417          881 GYACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDS  960 (1534)
Q Consensus       881 pykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp  960 (1534)
                      -|.|..|...|...-.|.+|.-..--.      .-|+|++|+|.|+-..+|..| ++.|...-   .-.+     .+..+
T Consensus       267 dyiCqLCK~kYeD~F~LAQHrC~RIV~------vEYrCPEC~KVFsCPANLASH-RRWHKPR~---eaa~-----a~~~P  331 (500)
T KOG3993|consen  267 DYICQLCKEKYEDAFALAQHRCPRIVH------VEYRCPECDKVFSCPANLASH-RRWHKPRP---EAAK-----AGSPP  331 (500)
T ss_pred             HHHHHHHHHhhhhHHHHhhccCCeeEE------eeecCCcccccccCchhhhhh-hcccCCch---hhhh-----cCCCC
Confidence            399999999999999999996321111      248999999999999999999 99996220   0000     11111


Q ss_pred             CccccCCCchhhhhhhh--hcCCcceeeecccCCccCChhHHHHHHHhhccCC-CCC-----------------------
Q 000417          961 PKKLELGYSASVENHSE--NLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMGP-NLV----------------------- 1014 (1534)
Q Consensus       961 ~~C~~Cgk~~sLk~Hlr--tHtgeKpykC~~CgKsF~sks~LkrHH~rtHtge-~~~----------------------- 1014 (1534)
                      -+-. -..+...++-.|  ....+.-|.|.+|+|+|.++..|++ |+.+|... ...                       
T Consensus       332 ~k~~-~~~rae~~ea~rsg~dss~gi~~C~~C~KkFrRqAYLrK-Hqlthq~~~~~k~~a~~f~~s~~~~l~~~~~~~a~  409 (500)
T KOG3993|consen  332 PKQA-VETRAEVQEAERSGDDSSSGIFSCHTCGKKFRRQAYLRK-HQLTHQRAPLAKEKAPKFLLSRVIPLMHFNQAVAT  409 (500)
T ss_pred             hhhh-hhhhhhhhhccccCCcccCceeecHHhhhhhHHHHHHHH-hHHhhhccccchhcccCcchhhccccccccccccc
Confidence            1100 000000000011  0122357999999999999999999 66666531 100                       


Q ss_pred             -----------------CCCCcccCCCCcccCCchhhhcccccccCCCCccCCCCCCcCCChHHHHhhccc
Q 000417         1015 -----------------NSRPHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRIRNRGAAGMKKRIQTLKP 1068 (1534)
Q Consensus      1015 -----------------~eKpYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~iCgksFs~~~~L~kH~Ks 1068 (1534)
                                       ......|++|+-.+.++..--.|.+.-..+..|.|.+|.-.|.....|.+|...
T Consensus       410 h~~a~~~~g~~vl~~a~sael~~pp~~~~ppsss~~sgg~~rlg~~~q~f~~ky~~atfyss~~ltrhin~  480 (500)
T KOG3993|consen  410 HSSASDSHGDEVLYVAGSAELELPPYDGSPPSSSGSSGGYGRLGIAEQGFTCKYCPATFYSSPGLTRHINK  480 (500)
T ss_pred             ccccccccccceeeeeccccccCCCCCCCCcccCCCCCccccccchhhccccccchHhhhcCcchHhHhhh
Confidence                             022235677777777777777777776677779999999999999999998763


No 34 
>KOG2461 consensus Transcription factor BLIMP-1/PRDI-BF1, contains C2H2-type Zn-finger and SET domains [Transcription]
Probab=97.79  E-value=2.3e-05  Score=94.91  Aligned_cols=114  Identities=26%  Similarity=0.262  Sum_probs=85.1

Q ss_pred             ceeeEEEEecC--CCCccccccccccCCCeEEEeeeEe-ecHHHHHHHhccccCCCcceEEecCcccccccccccCceeE
Q 000417         1377 VRVKLEVFKTE--NKGWAVRAGQAILRGTFVCEYIGEV-LDELETNKRRSRYGRDGCGYMLNIGAHINDMGRLIEGQVRY 1453 (1534)
Q Consensus      1377 ~~~~LeVf~T~--~kGwGVrA~edI~kGtfI~EY~GEI-it~~ea~~R~~~y~~~~~sYlf~ld~~~~d~~~l~~~~~~~ 1453 (1534)
                      +...|.|+.+.  ..|.||++...|++|+--+-|.|++ ++..+        ...+..|++.+-..         +..-+
T Consensus        26 LP~~l~i~~Ssv~~~~lgV~s~~~i~~G~~FGP~~G~~~~~~~~--------~~~n~~y~W~I~~~---------d~~~~   88 (396)
T KOG2461|consen   26 LPPELRIKPSSVPVTGLGVWSNASILPGTSFGPFEGEIIASIDS--------KSANNRYMWEIFSS---------DNGYE   88 (396)
T ss_pred             CCCceEeeccccCCccccccccccccCcccccCccCcccccccc--------ccccCcceEEEEeC---------CCceE
Confidence            66678888774  4789999999999999999999998 22211        11223466655331         12468


Q ss_pred             EEeccc--cCCcccccccCCC---CCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCCC
Q 000417         1454 VIDATK--YGNVSRFINHSCF---PNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYELL 1515 (1534)
Q Consensus      1454 ~IDA~~--~GNvaRFINHSC~---PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~~ 1515 (1534)
                      +||++.  ..|+.||+|=+++   -|+.+...        ...|.++|+|+|++||||.+.|+.++.
T Consensus        89 ~iDg~d~~~sNWmRYV~~Ar~~eeQNL~A~Q~--------~~~Ifyrt~r~I~p~eELlVWY~~e~~  147 (396)
T KOG2461|consen   89 YIDGTDEEHSNWMRYVNSARSEEEQNLLAFQI--------GENIFYRTIRDIRPNEELLVWYGSEYA  147 (396)
T ss_pred             EeccCChhhcceeeeecccCChhhhhHHHHhc--------cCceEEEecccCCCCCeEEEEeccchH
Confidence            999875  7999999999998   57766332        234889999999999999999998863


No 35 
>PF13465 zf-H2C2_2:  Zinc-finger double domain; PDB: 2EN7_A 1TF6_A 1TF3_A 2ELT_A 2EOS_A 2EN2_A 2DMD_A 2WBS_A 2WBU_A 2EM5_A ....
Probab=97.58  E-value=2.9e-05  Score=58.75  Aligned_cols=24  Identities=21%  Similarity=0.654  Sum_probs=12.1

Q ss_pred             hhhhhhhcCCcceeeecccCCccC
Q 000417          972 VENHSENLGSIRKFICRFCGLKFD  995 (1534)
Q Consensus       972 Lk~HlrtHtgeKpykC~~CgKsF~  995 (1534)
                      |..|+++|++++||+|+.|+++|.
T Consensus         2 l~~H~~~H~~~k~~~C~~C~k~F~   25 (26)
T PF13465_consen    2 LRRHMRTHTGEKPYKCPYCGKSFS   25 (26)
T ss_dssp             HHHHHHHHSSSSSEEESSSSEEES
T ss_pred             HHHHhhhcCCCCCCCCCCCcCeeC
Confidence            444555555555555555555543


No 36 
>PHA00732 hypothetical protein
Probab=97.37  E-value=0.00012  Score=69.85  Aligned_cols=48  Identities=21%  Similarity=0.214  Sum_probs=31.6

Q ss_pred             eeeecccCCccCChhHHHHHHHh-hccCCCCCCCCCcccCCCCcccCCchhhhcccccccC
Q 000417          984 KFICRFCGLKFDLLPDLGRHHQA-AHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKG 1043 (1534)
Q Consensus       984 pykC~~CgKsF~sks~LkrHH~r-tHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~g 1043 (1534)
                      ||+|+.||+.|.+..+|.. |++ .|++        +.|+.|++.|.   .|..|++++..
T Consensus         1 py~C~~Cgk~F~s~s~Lk~-H~r~~H~~--------~~C~~CgKsF~---~l~~H~~~~~~   49 (79)
T PHA00732          1 MFKCPICGFTTVTLFALKQ-HARRNHTL--------TKCPVCNKSYR---RLNQHFYSQYD   49 (79)
T ss_pred             CccCCCCCCccCCHHHHHH-HhhcccCC--------CccCCCCCEeC---ChhhhhcccCC
Confidence            4677777777777777777 454 3543        46777777776   46667655544


No 37 
>PF13465 zf-H2C2_2:  Zinc-finger double domain; PDB: 2EN7_A 1TF6_A 1TF3_A 2ELT_A 2EOS_A 2EN2_A 2DMD_A 2WBS_A 2WBU_A 2EM5_A ....
Probab=97.32  E-value=0.00013  Score=55.26  Aligned_cols=25  Identities=28%  Similarity=0.402  Sum_probs=18.1

Q ss_pred             HHHHHHHhhccCCCCCCCCCcccCCCCcccC
Q 000417          999 DLGRHHQAAHMGPNLVNSRPHKKGIRFYAYK 1029 (1534)
Q Consensus       999 ~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~ 1029 (1534)
                      +|.+ |+++|++     ++||+|++|+++|.
T Consensus         1 ~l~~-H~~~H~~-----~k~~~C~~C~k~F~   25 (26)
T PF13465_consen    1 NLRR-HMRTHTG-----EKPYKCPYCGKSFS   25 (26)
T ss_dssp             HHHH-HHHHHSS-----SSSEEESSSSEEES
T ss_pred             CHHH-HhhhcCC-----CCCCCCCCCcCeeC
Confidence            4667 6677777     77777777777775


No 38 
>PHA00616 hypothetical protein
Probab=97.21  E-value=6.6e-05  Score=63.52  Aligned_cols=26  Identities=19%  Similarity=0.280  Sum_probs=13.2

Q ss_pred             eeeecccCCccCChhHHHHHHHhhccC
Q 000417          984 KFICRFCGLKFDLLPDLGRHHQAAHMG 1010 (1534)
Q Consensus       984 pykC~~CgKsF~sks~LkrHH~rtHtg 1010 (1534)
                      ||+|+.||+.|..+++|.+ |++.|+|
T Consensus         1 pYqC~~CG~~F~~~s~l~~-H~r~~hg   26 (44)
T PHA00616          1 MYQCLRCGGIFRKKKEVIE-HLLSVHK   26 (44)
T ss_pred             CCccchhhHHHhhHHHHHH-HHHHhcC
Confidence            3455555555555555555 4444444


No 39 
>PHA00732 hypothetical protein
Probab=97.09  E-value=0.00026  Score=67.59  Aligned_cols=46  Identities=11%  Similarity=-0.099  Sum_probs=38.8

Q ss_pred             CcccCCCCcccCCchhhhccccc-ccCCCCccCCCCCCcCCChHHHHhhcccc
Q 000417         1018 PHKKGIRFYAYKLKSGRLSRPRF-KKGLGAVSYRIRNRGAAGMKKRIQTLKPL 1069 (1534)
Q Consensus      1018 pYkC~iC~K~F~sks~L~rH~r~-H~gekpy~C~iCgksFs~~~~L~kH~KsH 1069 (1534)
                      ||.|+.|++.|.+..+|+.|++. |+   ++.|+.|++.|.+   +..|.+++
T Consensus         1 py~C~~Cgk~F~s~s~Lk~H~r~~H~---~~~C~~CgKsF~~---l~~H~~~~   47 (79)
T PHA00732          1 MFKCPICGFTTVTLFALKQHARRNHT---LTKCPVCNKSYRR---LNQHFYSQ   47 (79)
T ss_pred             CccCCCCCCccCCHHHHHHHhhcccC---CCccCCCCCEeCC---hhhhhccc
Confidence            68999999999999999999985 65   3689999999984   66666644


No 40 
>PF05605 zf-Di19:  Drought induced 19 protein (Di19), zinc-binding;  InterPro: IPR008598 This entry consists of several drought induced 19 (Di19) like and RING finger 114 proteins. Di19 has been found to be strongly expressed in both the roots and leaves of Arabidopsis thaliana during progressive drought [], whilst RING finger proteins are thought to play a role in spermatogenesis. The precise function is unknown.
Probab=97.07  E-value=0.00035  Score=61.88  Aligned_cols=53  Identities=17%  Similarity=0.162  Sum_probs=42.7

Q ss_pred             eeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccccC
Q 000417          984 KFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKG 1043 (1534)
Q Consensus       984 pykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~g 1043 (1534)
                      .|.|++|++ ..+...|..|....|..+    .+.+.|++|...+.  .+|.+|+..+++
T Consensus         2 ~f~CP~C~~-~~~~~~L~~H~~~~H~~~----~~~v~CPiC~~~~~--~~l~~Hl~~~H~   54 (54)
T PF05605_consen    2 SFTCPYCGK-GFSESSLVEHCEDEHRSE----SKNVVCPICSSRVT--DNLIRHLNSQHR   54 (54)
T ss_pred             CcCCCCCCC-ccCHHHHHHHHHhHCcCC----CCCccCCCchhhhh--hHHHHHHHHhcC
Confidence            489999999 456788999888889884    46799999998755  489999977653


No 41 
>PHA00616 hypothetical protein
Probab=96.93  E-value=0.00029  Score=59.68  Aligned_cols=34  Identities=3%  Similarity=-0.224  Sum_probs=32.1

Q ss_pred             CcccCCCCcccCCchhhhcccccccCCCCccCCC
Q 000417         1018 PHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRI 1051 (1534)
Q Consensus      1018 pYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~i 1051 (1534)
                      ||+|+.||+.|.+++.|.+|++.|||+++++|+.
T Consensus         1 pYqC~~CG~~F~~~s~l~~H~r~~hg~~~~~~~~   34 (44)
T PHA00616          1 MYQCLRCGGIFRKKKEVIEHLLSVHKQNKLTLEY   34 (44)
T ss_pred             CCccchhhHHHhhHHHHHHHHHHhcCCCccceeE
Confidence            6999999999999999999999999999998864


No 42 
>PF05605 zf-Di19:  Drought induced 19 protein (Di19), zinc-binding;  InterPro: IPR008598 This entry consists of several drought induced 19 (Di19) like and RING finger 114 proteins. Di19 has been found to be strongly expressed in both the roots and leaves of Arabidopsis thaliana during progressive drought [], whilst RING finger proteins are thought to play a role in spermatogenesis. The precise function is unknown.
Probab=96.88  E-value=0.00084  Score=59.49  Aligned_cols=52  Identities=27%  Similarity=0.587  Sum_probs=34.3

Q ss_pred             cccCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcc
Q 000417          847 THKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERH  905 (1534)
Q Consensus       847 pykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh  905 (1534)
                      .|.||.|++ ..+...|..|+...|..+.    +.+.|++|...+.  .+|..|+..+|
T Consensus         2 ~f~CP~C~~-~~~~~~L~~H~~~~H~~~~----~~v~CPiC~~~~~--~~l~~Hl~~~H   53 (54)
T PF05605_consen    2 SFTCPYCGK-GFSESSLVEHCEDEHRSES----KNVVCPICSSRVT--DNLIRHLNSQH   53 (54)
T ss_pred             CcCCCCCCC-ccCHHHHHHHHHhHCcCCC----CCccCCCchhhhh--hHHHHHHHHhc
Confidence            467777777 4455677777777776652    4577777776544  37777776655


No 43 
>COG5189 SFP1 Putative transcriptional repressor regulating G2/M transition [Transcription / Cell division and chromosome partitioning]
Probab=96.72  E-value=0.00084  Score=76.94  Aligned_cols=57  Identities=19%  Similarity=0.280  Sum_probs=46.1

Q ss_pred             cceeeecc--cCCccCChhHHHHHHHhhccCCCC-------------CCCCCcccCCCCcccCCchhhhccc
Q 000417          982 IRKFICRF--CGLKFDLLPDLGRHHQAAHMGPNL-------------VNSRPHKKGIRFYAYKLKSGRLSRP 1038 (1534)
Q Consensus       982 eKpykC~~--CgKsF~sks~LkrHH~rtHtge~~-------------~~eKpYkC~iC~K~F~sks~L~rH~ 1038 (1534)
                      +|||+|++  |.|+|+....|+-|.+.-|..+..             .+.|||.|++|+|+|+....|+.|.
T Consensus       347 ~KpykCpV~gC~K~YknqnGLKYH~lhGH~~~~~~~~p~p~~~~~F~~~~KPYrCevC~KRYKNlNGLKYHr  418 (423)
T COG5189         347 GKPYKCPVEGCNKKYKNQNGLKYHMLHGHQNQKLHENPSPEKMNIFSAKDKPYRCEVCDKRYKNLNGLKYHR  418 (423)
T ss_pred             CceecCCCCCchhhhccccchhhhhhccccCcccCCCCCccccccccccCCceeccccchhhccCccceecc
Confidence            59999976  999999999999976666643211             2368999999999999999999995


No 44 
>PF12756 zf-C2H2_2:  C2H2 type zinc-finger (2 copies); PDB: 2DMI_A.
Probab=95.71  E-value=0.0057  Score=59.37  Aligned_cols=72  Identities=22%  Similarity=0.396  Sum_probs=16.7

Q ss_pred             ccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCCCCccccCCCchhhhhhhhhcCCcceeeecccCCccCC
Q 000417          917 QCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSPKKLELGYSASVENHSENLGSIRKFICRFCGLKFDL  996 (1534)
Q Consensus       917 kC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKsF~s  996 (1534)
                      +|..|+..|.+...|..|+...|.-.+..                 .........+..+.+.-. ...+.|..|++.|.+
T Consensus         1 ~C~~C~~~f~~~~~l~~H~~~~H~~~~~~-----------------~~~l~~~~~~~~~~~~~~-~~~~~C~~C~~~f~s   62 (100)
T PF12756_consen    1 QCLFCDESFSSVDDLLQHMKKKHGFDIPD-----------------QKYLVDPNRLLNYLRKKV-KESFRCPYCNKTFRS   62 (100)
T ss_dssp             ------------------------------------------------------------------SSEEBSSSS-EESS
T ss_pred             Ccccccccccccccccccccccccccccc-----------------cccccccccccccccccc-CCCCCCCccCCCCcC
Confidence            49999999999999999988888622110                 000001111222222111 125788888888888


Q ss_pred             hhHHHHHHHhh
Q 000417          997 LPDLGRHHQAA 1007 (1534)
Q Consensus       997 ks~LkrHH~rt 1007 (1534)
                      ...|.. |++.
T Consensus        63 ~~~l~~-Hm~~   72 (100)
T PF12756_consen   63 REALQE-HMRS   72 (100)
T ss_dssp             HHHHHH-HHHH
T ss_pred             HHHHHH-HHcC
Confidence            888888 4443


No 45 
>PF00096 zf-C2H2:  Zinc finger, C2H2 type;  InterPro: IPR007087 Zinc finger (Znf) domains are relatively small protein motifs which contain multiple finger-like protrusions that make tandem contacts with their target molecule. Some of these domains bind zinc, but many do not; instead binding other metals such as iron, or no metal at all. For example, some family members form salt bridges to stabilise the finger-like folds. They were first identified as a DNA-binding motif in transcription factor TFIIIA from Xenopus laevis (African clawed frog), however they are now recognised to bind DNA, RNA, protein and/or lipid substrates [, , , , ]. Their binding properties depend on the amino acid sequence of the finger domains and of the linker between fingers, as well as on the higher-order structures and the number of fingers. Znf domains are often found in clusters, where fingers can have different binding specificities. There are many superfamilies of Znf motifs, varying in both sequence and structure. They display considerable versatility in binding modes, even between members of the same class (e.g. some bind DNA, others protein), suggesting that Znf motifs are stable scaffolds that have evolved specialised functions. For example, Znf-containing proteins function in gene transcription, translation, mRNA trafficking, cytoskeleton organisation, epithelial development, cell adhesion, protein folding, chromatin remodelling and zinc sensing, to name but a few []. Zinc-binding motifs are stable structures, and they rarely undergo conformational changes upon binding their target.  The C2H2 zinc finger is the classical zinc finger domain. The two conserved cysteines and histidines co-ordinate a zinc ion. The following pattern describes the zinc finger: #-X-C-X(1-5)-C-X3-#-X5-#-X2-H-X(3-6)-[H/C], where X can be any amino acid, and numbers in brackets indicate the number of residues. The positions marked # are those that are important for the stable fold of the zinc finger. The final position can be either his or cys. The C2H2 zinc finger is composed of two short beta strands followed by an alpha helix. The amino terminal part of the helix binds the major groove in DNA binding zinc fingers. The accepted consensus binding sequence for Sp1 is usually defined by the asymmetric hexanucleotide core GGGCGG but this sequence does not include, among others, the GAG (=CTC) repeat that constitutes a high-affinity site for Sp1 binding to the wt1 promoter []. This entry represents the classical C2H2 zinc finger domain.  More information about these proteins can be found at Protein of the Month: Zinc Fingers [].; GO: 0008270 zinc ion binding, 0005622 intracellular; PDB: 2D9H_A 2EPC_A 1SP1_A 1VA3_A 2WBT_B 2ELR_A 2YTP_A 2YTT_A 1VA1_A 2ELO_A ....
Probab=95.63  E-value=0.006  Score=44.37  Aligned_cols=23  Identities=35%  Similarity=0.782  Sum_probs=14.0

Q ss_pred             eeecccCCccCChhHHHHHHHhhc
Q 000417          985 FICRFCGLKFDLLPDLGRHHQAAH 1008 (1534)
Q Consensus       985 ykC~~CgKsF~sks~LkrHH~rtH 1008 (1534)
                      |+|+.|++.|.++..|.+ |++.|
T Consensus         1 y~C~~C~~~f~~~~~l~~-H~~~H   23 (23)
T PF00096_consen    1 YKCPICGKSFSSKSNLKR-HMRRH   23 (23)
T ss_dssp             EEETTTTEEESSHHHHHH-HHHHH
T ss_pred             CCCCCCCCccCCHHHHHH-HHhHC
Confidence            566666666666666666 44434


No 46 
>PF00096 zf-C2H2:  Zinc finger, C2H2 type;  InterPro: IPR007087 Zinc finger (Znf) domains are relatively small protein motifs which contain multiple finger-like protrusions that make tandem contacts with their target molecule. Some of these domains bind zinc, but many do not; instead binding other metals such as iron, or no metal at all. For example, some family members form salt bridges to stabilise the finger-like folds. They were first identified as a DNA-binding motif in transcription factor TFIIIA from Xenopus laevis (African clawed frog), however they are now recognised to bind DNA, RNA, protein and/or lipid substrates [, , , , ]. Their binding properties depend on the amino acid sequence of the finger domains and of the linker between fingers, as well as on the higher-order structures and the number of fingers. Znf domains are often found in clusters, where fingers can have different binding specificities. There are many superfamilies of Znf motifs, varying in both sequence and structure. They display considerable versatility in binding modes, even between members of the same class (e.g. some bind DNA, others protein), suggesting that Znf motifs are stable scaffolds that have evolved specialised functions. For example, Znf-containing proteins function in gene transcription, translation, mRNA trafficking, cytoskeleton organisation, epithelial development, cell adhesion, protein folding, chromatin remodelling and zinc sensing, to name but a few []. Zinc-binding motifs are stable structures, and they rarely undergo conformational changes upon binding their target.  The C2H2 zinc finger is the classical zinc finger domain. The two conserved cysteines and histidines co-ordinate a zinc ion. The following pattern describes the zinc finger: #-X-C-X(1-5)-C-X3-#-X5-#-X2-H-X(3-6)-[H/C], where X can be any amino acid, and numbers in brackets indicate the number of residues. The positions marked # are those that are important for the stable fold of the zinc finger. The final position can be either his or cys. The C2H2 zinc finger is composed of two short beta strands followed by an alpha helix. The amino terminal part of the helix binds the major groove in DNA binding zinc fingers. The accepted consensus binding sequence for Sp1 is usually defined by the asymmetric hexanucleotide core GGGCGG but this sequence does not include, among others, the GAG (=CTC) repeat that constitutes a high-affinity site for Sp1 binding to the wt1 promoter []. This entry represents the classical C2H2 zinc finger domain.  More information about these proteins can be found at Protein of the Month: Zinc Fingers [].; GO: 0008270 zinc ion binding, 0005622 intracellular; PDB: 2D9H_A 2EPC_A 1SP1_A 1VA3_A 2WBT_B 2ELR_A 2YTP_A 2YTT_A 1VA1_A 2ELO_A ....
Probab=95.63  E-value=0.0029  Score=46.06  Aligned_cols=23  Identities=22%  Similarity=-0.042  Sum_probs=19.2

Q ss_pred             cccCCCCcccCCchhhhcccccc
Q 000417         1019 HKKGIRFYAYKLKSGRLSRPRFK 1041 (1534)
Q Consensus      1019 YkC~iC~K~F~sks~L~rH~r~H 1041 (1534)
                      |+|+.|++.|.++..|.+|++.|
T Consensus         1 y~C~~C~~~f~~~~~l~~H~~~H   23 (23)
T PF00096_consen    1 YKCPICGKSFSSKSNLKRHMRRH   23 (23)
T ss_dssp             EEETTTTEEESSHHHHHHHHHHH
T ss_pred             CCCCCCCCccCCHHHHHHHHhHC
Confidence            67888888888888888888764


No 47 
>COG5189 SFP1 Putative transcriptional repressor regulating G2/M transition [Transcription / Cell division and chromosome partitioning]
Probab=95.60  E-value=0.0042  Score=71.40  Aligned_cols=67  Identities=19%  Similarity=0.400  Sum_probs=41.5

Q ss_pred             CCcccCCC--CCcccCChhhHhhhhhcccCccccccCCccccC--ccCcccCChHHHHhHhhhccccccccccccccccc
Q 000417          845 EKTHKCKI--CSQVFLHDQELGVHWMDNHKKEAQWLFRGYACA--ICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIP  920 (1534)
Q Consensus       845 ekpykC~~--CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~--~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~  920 (1534)
                      +|||+|++  |+|.|+....|+-|+..-|...     +.+.=+  +=-..|                  ....|||+|++
T Consensus       347 ~KpykCpV~gC~K~YknqnGLKYH~lhGH~~~-----~~~~~p~p~~~~~F------------------~~~~KPYrCev  403 (423)
T COG5189         347 GKPYKCPVEGCNKKYKNQNGLKYHMLHGHQNQ-----KLHENPSPEKMNIF------------------SAKDKPYRCEV  403 (423)
T ss_pred             CceecCCCCCchhhhccccchhhhhhccccCc-----ccCCCCCccccccc------------------cccCCceeccc
Confidence            58999986  9999999999999955445332     111100  000111                  11226777777


Q ss_pred             CCCccCChHHHhhh
Q 000417          921 CGSHFGNTEELWLH  934 (1534)
Q Consensus       921 CgK~Fssk~~Lk~H  934 (1534)
                      |+|.+.+...|+.|
T Consensus       404 C~KRYKNlNGLKYH  417 (423)
T COG5189         404 CDKRYKNLNGLKYH  417 (423)
T ss_pred             cchhhccCccceec
Confidence            77777777777777


No 48 
>PF12756 zf-C2H2_2:  C2H2 type zinc-finger (2 copies); PDB: 2DMI_A.
Probab=95.59  E-value=0.0053  Score=59.58  Aligned_cols=73  Identities=19%  Similarity=0.302  Sum_probs=19.7

Q ss_pred             cCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcccccccccccccccccCCCccCCh
Q 000417          849 KCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNT  928 (1534)
Q Consensus       849 kC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk  928 (1534)
                      +|..|+..|.+...|..|+...|.-.     .+     ....+.....+..+++....       ..+.|..|++.|.+.
T Consensus         1 ~C~~C~~~f~~~~~l~~H~~~~H~~~-----~~-----~~~~l~~~~~~~~~~~~~~~-------~~~~C~~C~~~f~s~   63 (100)
T PF12756_consen    1 QCLFCDESFSSVDDLLQHMKKKHGFD-----IP-----DQKYLVDPNRLLNYLRKKVK-------ESFRCPYCNKTFRSR   63 (100)
T ss_dssp             -----------------------------------------------------------------SSEEBSSSS-EESSH
T ss_pred             Cccccccccccccccccccccccccc-----cc-----cccccccccccccccccccC-------CCCCCCccCCCCcCH
Confidence            59999999999999999987888654     11     12223344445455432221       247899999999999


Q ss_pred             HHHhhhhhcc
Q 000417          929 EELWLHVQSV  938 (1534)
Q Consensus       929 ~~Lk~H~~rv  938 (1534)
                      ..|..||+..
T Consensus        64 ~~l~~Hm~~~   73 (100)
T PF12756_consen   64 EALQEHMRSK   73 (100)
T ss_dssp             HHHHHHHHHT
T ss_pred             HHHHHHHcCc
Confidence            9999996543


No 49 
>KOG1146 consensus Homeobox protein [General function prediction only]
Probab=95.31  E-value=0.0064  Score=80.90  Aligned_cols=177  Identities=15%  Similarity=0.171  Sum_probs=109.6

Q ss_pred             cCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcccccccc-----------------
Q 000417          849 KCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVE-----------------  911 (1534)
Q Consensus       849 kC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~-----------------  911 (1534)
                      .|..|+..+.+...+.-|+...|...     +.|+|+.|+..|+....|..|||..|.+....                 
T Consensus       438 e~~~~e~~~~s~r~~~~~t~~L~S~~-----kt~~cpkc~~~yk~a~~L~vhmRskhp~~~~~~c~~gq~~~~~arg~~~  512 (1406)
T KOG1146|consen  438 ELTKAEPLLESKRSLEGQTVVLHSFF-----KTLKCPKCNWHYKLAQTLGVHMRSKHPESQSAYCKAGQNHPRLARGEVY  512 (1406)
T ss_pred             cccchhhhhhhhcccccceeeeeccc-----ccccCCccchhhhhHHHhhhcccccccccchhHhHhccccccccccccc
Confidence            46677778888888888877777665     88999999999999999999999855432111                 


Q ss_pred             --cccccccccCCCccCChHHHhhhhhcc-ccCcccchhhhhhcccccCC----CCC-ccccCCCchhhhhhhhh--cCC
Q 000417          912 --QCMLQQCIPCGSHFGNTEELWLHVQSV-HAIDFKMSEVAQQHNQSVGE----DSP-KKLELGYSASVENHSEN--LGS  981 (1534)
Q Consensus       912 --~~kpykC~~CgK~Fssk~~Lk~H~~rv-H~~ef~C~~C~k~f~~~~ge----Kp~-~C~~Cgk~~sLk~Hlrt--Htg  981 (1534)
                        ..++|.|..|...++.+.+|.+|++.. |..+      .+......++    .+. .|..+.....+-.-.-.  -..
T Consensus       513 ~~~~~p~~C~~C~~stttng~LsihlqS~~h~~~------lee~~~~~g~~v~~~~~~v~s~~P~~ag~~~~ags~~pkt  586 (1406)
T KOG1146|consen  513 RCPGKPYPCRACNYSTTTNGNLSIHLQSDLHRNE------LEEAEENAGEQVRLLPASVTSAVPEEAGLGPSAGSSGPKT  586 (1406)
T ss_pred             cCCCCcccceeeeeeeecchHHHHHHHHHhhHHH------HHHHHhccccchhhhhhhhcccCcccccCCCCCCCCCCCC
Confidence              127899999999999999999997653 4311      0111110000    000 12222211111100000  011


Q ss_pred             cceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccc
Q 000417          982 IRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFK 1041 (1534)
Q Consensus       982 eKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H 1041 (1534)
                      .-++.|..|+..-.-..+|+.|....|.-     ..|--|-.|+-.+.....+..|.+.+
T Consensus       587 kP~~~C~vc~yetniarnlrihmtss~~s-----~~p~~~Lq~~it~~l~~~~~~~~~lp  641 (1406)
T KOG1146|consen  587 KPSWRCEVCSYETNIARNLRIHMTASPSS-----SPPSLVLQQNITSSLASLLGGQGRLP  641 (1406)
T ss_pred             CCCcchhhhcchhhhhhccccccccCCCC-----CChHHHhhhcchhhccccccCcCCCC
Confidence            13477888888777777777744444443     44567777777777777777777776


No 50 
>PF13894 zf-C2H2_4:  C2H2-type zinc finger; PDB: 2ELX_A 2EPP_A 2DLK_A 1X6H_A 2EOU_A 2EMB_A 2GQJ_A 2CSH_A 2WBT_B 2ELM_A ....
Probab=94.65  E-value=0.0092  Score=43.09  Aligned_cols=18  Identities=33%  Similarity=0.794  Sum_probs=9.4

Q ss_pred             eeecccCCccCChhHHHH
Q 000417          985 FICRFCGLKFDLLPDLGR 1002 (1534)
Q Consensus       985 ykC~~CgKsF~sks~Lkr 1002 (1534)
                      |.|++|++.|.+...|.+
T Consensus         1 ~~C~~C~~~~~~~~~l~~   18 (24)
T PF13894_consen    1 FQCPICGKSFRSKSELRQ   18 (24)
T ss_dssp             EE-SSTS-EESSHHHHHH
T ss_pred             CCCcCCCCcCCcHHHHHH
Confidence            455556666666655555


No 51 
>PF13912 zf-C2H2_6:  C2H2-type zinc finger; PDB: 1JN7_A 1FU9_A 2L1O_A 1NJQ_A 2EN8_A 2EMM_A 1FV5_A 1Y0J_B 2L6Z_B.
Probab=94.47  E-value=0.015  Score=44.00  Aligned_cols=23  Identities=9%  Similarity=-0.159  Sum_probs=10.0

Q ss_pred             cccCCCCcccCCchhhhcccccc
Q 000417         1019 HKKGIRFYAYKLKSGRLSRPRFK 1041 (1534)
Q Consensus      1019 YkC~iC~K~F~sks~L~rH~r~H 1041 (1534)
                      |+|..|++.|.+...|..|++.|
T Consensus         2 ~~C~~C~~~F~~~~~l~~H~~~h   24 (27)
T PF13912_consen    2 FECDECGKTFSSLSALREHKRSH   24 (27)
T ss_dssp             EEETTTTEEESSHHHHHHHHCTT
T ss_pred             CCCCccCCccCChhHHHHHhHHh
Confidence            34444444444444444444443


No 52 
>PF13894 zf-C2H2_4:  C2H2-type zinc finger; PDB: 2ELX_A 2EPP_A 2DLK_A 1X6H_A 2EOU_A 2EMB_A 2GQJ_A 2CSH_A 2WBT_B 2ELM_A ....
Probab=94.37  E-value=0.025  Score=40.80  Aligned_cols=22  Identities=36%  Similarity=0.738  Sum_probs=9.1

Q ss_pred             ccCccCcccCChHHHHhHhhhc
Q 000417          883 ACAICLDSFTNKKVLESHVQER  904 (1534)
Q Consensus       883 kC~~CgKsF~sks~L~~H~r~H  904 (1534)
                      .|++|++.|.+...|..|++.|
T Consensus         2 ~C~~C~~~~~~~~~l~~H~~~~   23 (24)
T PF13894_consen    2 QCPICGKSFRSKSELRQHMRTH   23 (24)
T ss_dssp             E-SSTS-EESSHHHHHHHHHHH
T ss_pred             CCcCCCCcCCcHHHHHHHHHhh
Confidence            3444444444444444444433


No 53 
>KOG2231 consensus Predicted E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=93.95  E-value=0.063  Score=68.67  Aligned_cols=11  Identities=45%  Similarity=1.165  Sum_probs=8.0

Q ss_pred             ccCCCCCcccC
Q 000417          848 HKCKICSQVFL  858 (1534)
Q Consensus       848 ykC~~CgK~F~  858 (1534)
                      +.|.+|++.|.
T Consensus       100 ~~C~~C~~~~~  110 (669)
T KOG2231|consen  100 HSCHICDRRFR  110 (669)
T ss_pred             hhcCccccchh
Confidence            67888877763


No 54 
>PF13912 zf-C2H2_6:  C2H2-type zinc finger; PDB: 1JN7_A 1FU9_A 2L1O_A 1NJQ_A 2EN8_A 2EMM_A 1FV5_A 1Y0J_B 2L6Z_B.
Probab=93.92  E-value=0.034  Score=42.02  Aligned_cols=26  Identities=35%  Similarity=0.686  Sum_probs=23.3

Q ss_pred             eeeecccCCccCChhHHHHHHHhhccC
Q 000417          984 KFICRFCGLKFDLLPDLGRHHQAAHMG 1010 (1534)
Q Consensus       984 pykC~~CgKsF~sks~LkrHH~rtHtg 1010 (1534)
                      ||+|..|++.|.+...|.. |++.|..
T Consensus         1 ~~~C~~C~~~F~~~~~l~~-H~~~h~~   26 (27)
T PF13912_consen    1 PFECDECGKTFSSLSALRE-HKRSHCS   26 (27)
T ss_dssp             SEEETTTTEEESSHHHHHH-HHCTTTT
T ss_pred             CCCCCccCCccCChhHHHH-HhHHhcC
Confidence            6899999999999999999 7787754


No 55 
>PF09237 GAGA:  GAGA factor;  InterPro: IPR015318 Zinc finger (Znf) domains are relatively small protein motifs which contain multiple finger-like protrusions that make tandem contacts with their target molecule. Some of these domains bind zinc, but many do not; instead binding other metals such as iron, or no metal at all. For example, some family members form salt bridges to stabilise the finger-like folds. They were first identified as a DNA-binding motif in transcription factor TFIIIA from Xenopus laevis (African clawed frog), however they are now recognised to bind DNA, RNA, protein and/or lipid substrates [, , , , ]. Their binding properties depend on the amino acid sequence of the finger domains and of the linker between fingers, as well as on the higher-order structures and the number of fingers. Znf domains are often found in clusters, where fingers can have different binding specificities. There are many superfamilies of Znf motifs, varying in both sequence and structure. They display considerable versatility in binding modes, even between members of the same class (e.g. some bind DNA, others protein), suggesting that Znf motifs are stable scaffolds that have evolved specialised functions. For example, Znf-containing proteins function in gene transcription, translation, mRNA trafficking, cytoskeleton organisation, epithelial development, cell adhesion, protein folding, chromatin remodelling and zinc sensing, to name but a few []. Zinc-binding motifs are stable structures, and they rarely undergo conformational changes upon binding their target.  Members of this entry bind to a 5'-GAGAG-3' DNA consensus binding site, and contain a Cys2-His2 zinc finger core as well as an N-terminal extension containing two highly basic regions. The zinc finger core binds in the DNA major groove and recognises the first three GAG bases of the consensus in a manner similar to that seen in other classical zinc finger-DNA complexes. The second basic region forms a helix that interacts in the major groove recognising the last G of the consensus, while the first basic region wraps around the DNA in the minor groove and recognises the A in the fourth position of the consensus sequence [].  More information about these proteins can be found at Protein of the Month: Zinc Fingers [].; PDB: 1YUI_A 1YUJ_A.
Probab=93.25  E-value=0.028  Score=49.13  Aligned_cols=31  Identities=6%  Similarity=-0.108  Sum_probs=16.6

Q ss_pred             CCCcccCCCCcccCCchhhhcccccccCCCC
Q 000417         1016 SRPHKKGIRFYAYKLKSGRLSRPRFKKGLGA 1046 (1534)
Q Consensus      1016 eKpYkC~iC~K~F~sks~L~rH~r~H~gekp 1046 (1534)
                      +.|..|++|+..+++..+|++|+..+|+.||
T Consensus        22 ~~PatCP~C~a~~~~srnLrRHle~~H~~k~   52 (54)
T PF09237_consen   22 EQPATCPICGAVIRQSRNLRRHLEIRHFKKP   52 (54)
T ss_dssp             S--EE-TTT--EESSHHHHHHHHHHHTTTS-
T ss_pred             CCCCCCCcchhhccchhhHHHHHHHHhcccC
Confidence            5566677777777777777777666665554


No 56 
>smart00508 PostSET Cysteine-rich motif following a subset of SET domains.
Probab=93.04  E-value=0.047  Score=41.62  Aligned_cols=15  Identities=60%  Similarity=1.325  Sum_probs=13.8

Q ss_pred             CceeeCCCCCCcccc
Q 000417         1519 GYPCHCGASKCRGRL 1533 (1534)
Q Consensus      1519 ~~~C~CGS~~CRG~l 1533 (1534)
                      .++|+|||.+|||+|
T Consensus         2 ~~~C~CGs~~CRG~l   16 (26)
T smart00508        2 KQPCLCGAPNCRGFL   16 (26)
T ss_pred             CeeeeCCCcccccee
Confidence            479999999999998


No 57 
>KOG2231 consensus Predicted E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=92.99  E-value=0.087  Score=67.46  Aligned_cols=109  Identities=21%  Similarity=0.127  Sum_probs=56.3

Q ss_pred             cccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCCCCcccc-CCCchhhhhhhhhc-CCcc----eeeecccC
Q 000417          918 CIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSPKKLE-LGYSASVENHSENL-GSIR----KFICRFCG  991 (1534)
Q Consensus       918 C~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~~C~~-Cgk~~sLk~HlrtH-tgeK----pykC~~Cg  991 (1534)
                      |..| ..|.....|+.|+...|. -+.|..|...      .+-+.|.. +-.+..|..|++.- .+++    .-.|..|.
T Consensus       118 ~~~c-~~~~s~~~Lk~H~~~~H~-~~~c~lC~~~------~kif~~e~k~Yt~~el~~h~~~gd~d~~s~rGhp~C~~C~  189 (669)
T KOG2231|consen  118 CLHC-TEFKSVENLKNHMRDQHK-LHLCSLCLQN------LKIFINERKLYTRAELNLHLMFGDPDDESCRGHPLCKFCH  189 (669)
T ss_pred             Cccc-cchhHHHHHHHHHHHhhh-hhcccccccc------ceeeeeeeehehHHHHHHHHhcCCCccccccCCccchhhh
Confidence            7777 667777777777656664 2334444331      11111111 11223455555421 1121    23577777


Q ss_pred             CccCChhHHHHHHHhhccCCCCCCCCCcccCCCC------cccCCchhhhcccccccCC
Q 000417          992 LKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRF------YAYKLKSGRLSRPRFKKGL 1044 (1534)
Q Consensus       992 KsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~------K~F~sks~L~rH~r~H~ge 1044 (1534)
                      ..|.....|.+|+...|          |.|.+|.      .-|.....|..|.|.+|-.
T Consensus       190 ~~fld~~el~rH~~~~h----------~~chfC~~~~~~neyy~~~~dLe~HfR~~Hfl  238 (669)
T KOG2231|consen  190 ERFLDDDELYRHLRFDH----------EFCHFCDYKTGQNEYYNDYDDLEEHFRKGHFL  238 (669)
T ss_pred             hhhccHHHHHHhhccce----------eheeecCcccccchhcccchHHHHHhhhcCcc
Confidence            77777777777433333          3455553      3455666677777665533


No 58 
>KOG1146 consensus Homeobox protein [General function prediction only]
Probab=92.46  E-value=0.066  Score=71.81  Aligned_cols=158  Identities=14%  Similarity=0.100  Sum_probs=104.8

Q ss_pred             cCccCcccCChHHHHhHhhhcccccccccccccccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCCCCcc
Q 000417          884 CAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSPKK  963 (1534)
Q Consensus       884 C~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~~C  963 (1534)
                      |.-|+..+..+..+.-|+..-+...     +.|+|+.|+..|.....|..||+..|... .-..|.              
T Consensus       439 ~~~~e~~~~s~r~~~~~t~~L~S~~-----kt~~cpkc~~~yk~a~~L~vhmRskhp~~-~~~~c~--------------  498 (1406)
T KOG1146|consen  439 LTKAEPLLESKRSLEGQTVVLHSFF-----KTLKCPKCNWHYKLAQTLGVHMRSKHPES-QSAYCK--------------  498 (1406)
T ss_pred             ccchhhhhhhhcccccceeeeeccc-----ccccCCccchhhhhHHHhhhccccccccc-chhHhH--------------
Confidence            5556666777777777766544432     67899999999999999999988777521 111111              


Q ss_pred             ccCCCchhhhhhhhhc------CCcceeeecccCCccCChhHHHHHHHhh-ccCC-------------------------
Q 000417          964 LELGYSASVENHSENL------GSIRKFICRFCGLKFDLLPDLGRHHQAA-HMGP------------------------- 1011 (1534)
Q Consensus       964 ~~Cgk~~sLk~HlrtH------tgeKpykC~~CgKsF~sks~LkrHH~rt-Htge------------------------- 1011 (1534)
                             .-+.|.+.-      .+-++|.|..|..+|..+.+|..|.+.. |..+                         
T Consensus       499 -------~gq~~~~~arg~~~~~~~~p~~C~~C~~stttng~LsihlqS~~h~~~lee~~~~~g~~v~~~~~~v~s~~P~  571 (1406)
T KOG1146|consen  499 -------AGQNHPRLARGEVYRCPGKPYPCRACNYSTTTNGNLSIHLQSDLHRNELEEAEENAGEQVRLLPASVTSAVPE  571 (1406)
T ss_pred             -------hccccccccccccccCCCCcccceeeeeeeecchHHHHHHHHHhhHHHHHHHHhccccchhhhhhhhcccCcc
Confidence                   011111111      1237899999999999999999964432 2110                         


Q ss_pred             ----------C-CCCCCCcccCCCCcccCCchhhhccc-ccccCCCCccCCCCCCcCCChHHHHhhccc
Q 000417         1012 ----------N-LVNSRPHKKGIRFYAYKLKSGRLSRP-RFKKGLGAVSYRIRNRGAAGMKKRIQTLKP 1068 (1534)
Q Consensus      1012 ----------~-~~~eKpYkC~iC~K~F~sks~L~rH~-r~H~gekpy~C~iCgksFs~~~~L~kH~Ks 1068 (1534)
                                . +...-.+.|.+|++.-.-..+|+.|| ..|+...|.-|-.|+-.+.....+..|.+-
T Consensus       572 ~ag~~~~ags~~pktkP~~~C~vc~yetniarnlrihmtss~~s~~p~~~Lq~~it~~l~~~~~~~~~l  640 (1406)
T KOG1146|consen  572 EAGLGPSAGSSGPKTKPSWRCEVCSYETNIARNLRIHMTASPSSSPPSLVLQQNITSSLASLLGGQGRL  640 (1406)
T ss_pred             cccCCCCCCCCCCCCCCCcchhhhcchhhhhhccccccccCCCCCChHHHhhhcchhhccccccCcCCC
Confidence                      0 11133589999999999999999999 455555557777777776666655555553


No 59 
>cd01395 HMT_MBD Methyl-CpG binding domains (MBD) present in putative histone methyltransferases (HMT) such as CLLD8 and SETDB1 proteins; CLLD8 contains a MBD, a PreSET and a bifurcated SET domain, suggesting that CLLD8 might be associated with methylation-mediated transcriptional repression. SETDB1 and other proteins in this group have a similar domain architecture. SETDB1 is a novel KAP-1-associated histone H3, lysine 9-specific methyltransferase that contributes to HP1-mediated silencing of euchromatic genes by KRAB zinc-finger proteins.
Probab=91.12  E-value=0.048  Score=49.68  Aligned_cols=36  Identities=14%  Similarity=0.042  Sum_probs=29.4

Q ss_pred             CCC-CCcccc----------cccccccCCCCcCCc-cccccceeeecc
Q 000417         1184 HLE-PLPSVS----------AGIRSSDSSDFVNNQ-WEVDECHCIIDS 1219 (1534)
Q Consensus      1184 p~~-~~~~~~----------~~~k~v~~~~~~~~~-~~~~e~~~~l~~ 1219 (1534)
                      ||+ |+..||          +.++.|+|++|||.. ++|.|+|.||..
T Consensus         1 PL~~Pll~gw~R~~~~~~~~~~k~~V~Y~aPCGr~Lr~~~EV~~YL~~   48 (60)
T cd01395           1 PLHTPLLCGFQRMKYRARVGKVKKHVIYKAPCGRSLRNMSEVHRYLRE   48 (60)
T ss_pred             CcccccccCeEEEEEeccCCCcccceEEECCcchhhhcHHHHHHHHHh
Confidence            566 777777          256679999999999 999999988764


No 60 
>smart00355 ZnF_C2H2 zinc finger.
Probab=90.60  E-value=0.17  Score=36.83  Aligned_cols=24  Identities=29%  Similarity=0.544  Sum_probs=14.3

Q ss_pred             eeecccCCccCChhHHHHHHHhhcc
Q 000417          985 FICRFCGLKFDLLPDLGRHHQAAHM 1009 (1534)
Q Consensus       985 ykC~~CgKsF~sks~LkrHH~rtHt 1009 (1534)
                      |+|+.|++.|.....|.. |++.|.
T Consensus         1 ~~C~~C~~~f~~~~~l~~-H~~~H~   24 (26)
T smart00355        1 YRCPECGKVFKSKSALKE-HMRTHX   24 (26)
T ss_pred             CCCCCCcchhCCHHHHHH-HHHHhc
Confidence            456666666666666666 444553


No 61 
>COG5048 FOG: Zn-finger [General function prediction only]
Probab=90.55  E-value=0.19  Score=60.29  Aligned_cols=62  Identities=11%  Similarity=0.084  Sum_probs=43.3

Q ss_pred             cCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccccCCCCccCCCCCCc
Q 000417          990 CGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRIRNRG 1055 (1534)
Q Consensus       990 CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~iCgks 1055 (1534)
                      |-..+.....+.. |...|....   ...+.+..|.+.|.....+..|++.|....++-|..++..
T Consensus       394 ~~~~~~~~~~~~~-~~~~~~~~~---~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~  455 (467)
T COG5048         394 CIRNFKRDSNLSL-HIITHLSFR---PYNCKNPPCSKSFNRHYNLIPHKKIHTNHAPLLCSILKSF  455 (467)
T ss_pred             hhhhhcccccccc-ccccccccC---CcCCCCCcchhhccCcccccccccccccCCceeecccccc
Confidence            6666677776766 566666511   2356777888888888888888888888777766555543


No 62 
>PRK04860 hypothetical protein; Provisional
Probab=90.52  E-value=0.098  Score=56.66  Aligned_cols=39  Identities=15%  Similarity=0.136  Sum_probs=27.5

Q ss_pred             ceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCc
Q 000417          983 RKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLK 1031 (1534)
Q Consensus       983 KpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sk 1031 (1534)
                      -+|.|. |++   ....+.+ |.++|++     +++|.|..|+..|...
T Consensus       118 ~~Y~C~-C~~---~~~~~rr-H~ri~~g-----~~~YrC~~C~~~l~~~  156 (160)
T PRK04860        118 FPYRCK-CQE---HQLTVRR-HNRVVRG-----EAVYRCRRCGETLVFK  156 (160)
T ss_pred             EEEEcC-CCC---eeCHHHH-HHHHhcC-----CccEECCCCCceeEEe
Confidence            367776 776   5666667 7777777     6777777777776644


No 63 
>PRK04860 hypothetical protein; Provisional
Probab=90.42  E-value=0.16  Score=55.02  Aligned_cols=36  Identities=11%  Similarity=-0.039  Sum_probs=23.1

Q ss_pred             CcccCCCCcccCCchhhhcccccccCCCCccCCCCCCcCC
Q 000417         1018 PHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRIRNRGAA 1057 (1534)
Q Consensus      1018 pYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~iCgksFs 1057 (1534)
                      +|.|. |++   ....+++|.++|+++++|.|..|++.|.
T Consensus       119 ~Y~C~-C~~---~~~~~rrH~ri~~g~~~YrC~~C~~~l~  154 (160)
T PRK04860        119 PYRCK-CQE---HQLTVRRHNRVVRGEAVYRCRRCGETLV  154 (160)
T ss_pred             EEEcC-CCC---eeCHHHHHHHHhcCCccEECCCCCceeE
Confidence            56666 665   5556666666666666666666666654


No 64 
>COG5236 Uncharacterized conserved protein, contains RING Zn-finger [General function prediction only]
Probab=90.22  E-value=0.17  Score=59.15  Aligned_cols=84  Identities=25%  Similarity=0.383  Sum_probs=54.5

Q ss_pred             cccCCC--CCcccCChhhHhhhhhcccCccccccCCccccCccCc---ccCC------hHHHHhHhhhcccccccccccc
Q 000417          847 THKCKI--CSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLD---SFTN------KKVLESHVQERHHVQFVEQCML  915 (1534)
Q Consensus       847 pykC~~--CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgK---sF~s------ks~L~~H~r~Hh~ek~~~~~kp  915 (1534)
                      .|.||.  |.........|+.|.+..|..        +-|.+|-+   .|..      +..|..|...-..+..+.  .-
T Consensus       151 ~F~CP~skc~~~C~~~k~lk~H~K~~H~~--------~~C~~C~~nKk~F~~E~~lF~~~~Lr~H~~~G~~e~GFK--GH  220 (493)
T COG5236         151 SFKCPKSKCHRRCGSLKELKKHYKAQHGF--------VLCSECIGNKKDFWNEIRLFRSSTLRDHKNGGLEEEGFK--GH  220 (493)
T ss_pred             HhcCCchhhhhhhhhHHHHHHHHHhhcCc--------EEhHhhhcCcccCccceeeeecccccccccCCccccCcC--CC
Confidence            488875  777777788899996666643        56777743   3443      445666643221110010  11


Q ss_pred             cccccCCCccCChHHHhhhhhcccc
Q 000417          916 QQCIPCGSHFGNTEELWLHVQSVHA  940 (1534)
Q Consensus       916 ykC~~CgK~Fssk~~Lk~H~~rvH~  940 (1534)
                      =.|..|...|-+-..|..|++..|.
T Consensus       221 P~C~FC~~~FYdDDEL~~HcR~~HE  245 (493)
T COG5236         221 PLCIFCKIYFYDDDELRRHCRLRHE  245 (493)
T ss_pred             chhhhccceecChHHHHHHHHhhhh
Confidence            2599999999999999999777775


No 65 
>cd05162 PWWP The PWWP domain, named for a conserved Pro-Trp-Trp-Pro motif, is a small domain consisting of 100-150 amino acids.  The PWWP domain is found in numerous proteins that are involved in cell division, growth and differentiation.  Most PWWP-domain proteins seem to be nuclear, often DNA-binding, proteins that function as transcription factors regulating a variety of developmental processes.  The function of the PWWP domain is still not known precisely; however, based on the fact that other regions of PWWP-domain proteins are responsible for nuclear localization and DNA-binding, is likely that the PWWP domain acts as a site for protein-protein binding interactions, influencing chromatin remodeling and thereby regulating transcriptional processes.  Some PWWP-domain proteins have been linked to cancer or other diseases; some are known to function as growth factors.
Probab=89.67  E-value=0.31  Score=47.19  Aligned_cols=60  Identities=18%  Similarity=0.474  Sum_probs=47.6

Q ss_pred             EEEEEecc-ccccceeeeeccCCCccccccccCCCccEEEEEeccCCcchhhhhhccccccCCCc
Q 000417          157 ALWVKWRG-KWQAGIRCARADWPLPTLKAKPTHDRKKYFVIFFPHTRNYSWADMLLVRSINEFPQ  220 (1534)
Q Consensus       157 ~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~  220 (1534)
                      -+|+|.+| -|--|+-+...+.+...   .+......|.|.||+ +++|.||+---|.+..++-.
T Consensus         6 lVwaK~~g~pwWPa~V~~~~~~~~~~---~~~~~~~~~~V~Ffg-~~~~~wv~~~~l~pf~~~~~   66 (87)
T cd05162           6 LVWAKMKGYPWWPALVVDPPKDSKKA---KKKAKEGKVLVLFFG-DKTFAWVGAERLKPFTEHKE   66 (87)
T ss_pred             EEEEeCCCCCCCCEEEccccccchhh---hccCCCCEEEEEEeC-CCcEEEeCccceeeccchHH
Confidence            48999999 78888888777766543   233345789999999 99999999999988887653


No 66 
>smart00355 ZnF_C2H2 zinc finger.
Probab=89.36  E-value=0.27  Score=35.69  Aligned_cols=20  Identities=30%  Similarity=0.684  Sum_probs=10.4

Q ss_pred             ccCccCcccCChHHHHhHhh
Q 000417          883 ACAICLDSFTNKKVLESHVQ  902 (1534)
Q Consensus       883 kC~~CgKsF~sks~L~~H~r  902 (1534)
                      .|..|++.|.....|..|++
T Consensus         2 ~C~~C~~~f~~~~~l~~H~~   21 (26)
T smart00355        2 RCPECGKVFKSKSALKEHMR   21 (26)
T ss_pred             CCCCCcchhCCHHHHHHHHH
Confidence            45555555555555555554


No 67 
>PF09237 GAGA:  GAGA factor;  InterPro: IPR015318 Zinc finger (Znf) domains are relatively small protein motifs which contain multiple finger-like protrusions that make tandem contacts with their target molecule. Some of these domains bind zinc, but many do not; instead binding other metals such as iron, or no metal at all. For example, some family members form salt bridges to stabilise the finger-like folds. They were first identified as a DNA-binding motif in transcription factor TFIIIA from Xenopus laevis (African clawed frog), however they are now recognised to bind DNA, RNA, protein and/or lipid substrates [, , , , ]. Their binding properties depend on the amino acid sequence of the finger domains and of the linker between fingers, as well as on the higher-order structures and the number of fingers. Znf domains are often found in clusters, where fingers can have different binding specificities. There are many superfamilies of Znf motifs, varying in both sequence and structure. They display considerable versatility in binding modes, even between members of the same class (e.g. some bind DNA, others protein), suggesting that Znf motifs are stable scaffolds that have evolved specialised functions. For example, Znf-containing proteins function in gene transcription, translation, mRNA trafficking, cytoskeleton organisation, epithelial development, cell adhesion, protein folding, chromatin remodelling and zinc sensing, to name but a few []. Zinc-binding motifs are stable structures, and they rarely undergo conformational changes upon binding their target.  Members of this entry bind to a 5'-GAGAG-3' DNA consensus binding site, and contain a Cys2-His2 zinc finger core as well as an N-terminal extension containing two highly basic regions. The zinc finger core binds in the DNA major groove and recognises the first three GAG bases of the consensus in a manner similar to that seen in other classical zinc finger-DNA complexes. The second basic region forms a helix that interacts in the major groove recognising the last G of the consensus, while the first basic region wraps around the DNA in the minor groove and recognises the A in the fourth position of the consensus sequence [].  More information about these proteins can be found at Protein of the Month: Zinc Fingers [].; PDB: 1YUI_A 1YUJ_A.
Probab=88.50  E-value=0.29  Score=43.09  Aligned_cols=29  Identities=24%  Similarity=0.500  Sum_probs=18.4

Q ss_pred             CccccCccCcccCChHHHHhHhhhccccc
Q 000417          880 RGYACAICLDSFTNKKVLESHVQERHHVQ  908 (1534)
Q Consensus       880 kpykC~~CgKsF~sks~L~~H~r~Hh~ek  908 (1534)
                      .|..|++|+..+....+|.+|+..+|+.+
T Consensus        23 ~PatCP~C~a~~~~srnLrRHle~~H~~k   51 (54)
T PF09237_consen   23 QPATCPICGAVIRQSRNLRRHLEIRHFKK   51 (54)
T ss_dssp             --EE-TTT--EESSHHHHHHHHHHHTTTS
T ss_pred             CCCCCCcchhhccchhhHHHHHHHHhccc
Confidence            67778888888888888888887777653


No 68 
>COG5048 FOG: Zn-finger [General function prediction only]
Probab=88.46  E-value=0.28  Score=58.83  Aligned_cols=139  Identities=16%  Similarity=0.050  Sum_probs=92.9

Q ss_pred             ccccccCCCccCChHHHhhhhhc-cccCcccchhhhhhcccccCC--CCCccc--cCCCch----hhhhhhhhcCCccee
Q 000417          915 LQQCIPCGSHFGNTEELWLHVQS-VHAIDFKMSEVAQQHNQSVGE--DSPKKL--ELGYSA----SVENHSENLGSIRKF  985 (1534)
Q Consensus       915 pykC~~CgK~Fssk~~Lk~H~~r-vH~~ef~C~~C~k~f~~~~ge--Kp~~C~--~Cgk~~----sLk~HlrtHtgeKpy  985 (1534)
                      ++.|..|...|.....|..|... .|.                ++  +++.|.  .|+..+    .+..|...|.+.+++
T Consensus       289 ~~~~~~~~~~~s~~~~l~~~~~~~~h~----------------~~~~~~~~~p~~~~~~~~~~~~~~~~~~~~~~~~~~~  352 (467)
T COG5048         289 PIKSKQCNISFSRSSPLTRHLRSVNHS----------------GESLKPFSCPYSLCGKLFSRNDALKRHILLHTSISPA  352 (467)
T ss_pred             CCCCccccCCccccccccccccccccc----------------cccCCceeeeccCCCccccccccccCCcccccCCCcc
Confidence            57799999999999999999332 665                44  666676  566444    356677777777777


Q ss_pred             eecc--cCCccCChhHHHHHHHhhccCCCCCCCCCcccCC--CCcccCCchhhhcccccccCCC--CccCCCCCCcCCCh
Q 000417          986 ICRF--CGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGI--RFYAYKLKSGRLSRPRFKKGLG--AVSYRIRNRGAAGM 1059 (1534)
Q Consensus       986 kC~~--CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~i--C~K~F~sks~L~rH~r~H~gek--py~C~iCgksFs~~ 1059 (1534)
                      +|..  |.+.+.....-.. +...+........+.+.|..  |-..+.....+..|...|...+  .+.+..|.+.|...
T Consensus       353 ~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~  431 (467)
T COG5048         353 KEKLLNSSSKFSPLLNNEP-PQSLQQYKDLKNDKKSETLSNSCIRNFKRDSNLSLHIITHLSFRPYNCKNPPCSKSFNRH  431 (467)
T ss_pred             ccccccCccccccccCCCC-ccchhhccCccCCccccccccchhhhhccccccccccccccccCCcCCCCCcchhhccCc
Confidence            7643  5555544433111 11111111111244555644  8888999999999998888876  46679999999999


Q ss_pred             HHHHhhccccC
Q 000417         1060 KKRIQTLKPLA 1070 (1534)
Q Consensus      1060 ~~L~kH~KsH~ 1070 (1534)
                      ..+..|++.|.
T Consensus       432 ~~~~~~~~~~~  442 (467)
T COG5048         432 YNLIPHKKIHT  442 (467)
T ss_pred             ccccccccccc
Confidence            99999988664


No 69 
>cd05840 SPBC215_ISWI_like The PWWP domain is a component of the S. pombe hypothetical protein SPBC215, as well as ISWI complex protein 4.  The ISWI (imitation switch) proteins are ATPases responsible for chromatin remodeling in eukaryotes, and SPBC215 is proposed to also bind chromatin.   The PWWP domain, named for a conserved Pro-Trp-Trp-Pro motif, is a small domain consisting of 100-150 amino acids. The PWWP domain is found in numerous proteins that are involved in cell division, growth and differentiation. Most PWWP-domain proteins seem to be nuclear, often DNA-binding,  proteins that function as transcription factors regulating a variety of developmental processes.
Probab=88.14  E-value=0.37  Score=47.80  Aligned_cols=59  Identities=24%  Similarity=0.430  Sum_probs=48.9

Q ss_pred             EEEEEeccc-cccceeeeeccCCCccccccccCCCccEEEEEeccCCcchhhhhhcccccc
Q 000417          157 ALWVKWRGK-WQAGIRCARADWPLPTLKAKPTHDRKKYFVIFFPHTRNYSWADMLLVRSIN  216 (1534)
Q Consensus       157 ~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~  216 (1534)
                      -+|.|-+|- |=-|+=|...+-|-.-|++++......|.|.||+. ++|.|++--.+.+..
T Consensus         6 lVwaK~~GyPwWPA~V~~~~~~p~~~l~~~~~~~~~~~~V~FFg~-~~~~Wv~~~~l~pl~   65 (93)
T cd05840           6 RVLAKVKGFPAWPAIVVPEEMLPDSVLKGKKKKNKRTYPVMFFPD-GDYYWVPNKDLKPLT   65 (93)
T ss_pred             EEEEeCCCCCCCCEEECChHHCCHHHHhcccCCCCCeEEEEEeCC-CcEEEEChhhcccCC
Confidence            389999994 66777777777888888888888899999999995 699999887777665


No 70 
>PF13909 zf-H2C2_5:  C2H2-type zinc-finger domain; PDB: 1X5W_A.
Probab=86.88  E-value=0.17  Score=37.32  Aligned_cols=22  Identities=18%  Similarity=-0.055  Sum_probs=9.5

Q ss_pred             cccCCCCcccCCchhhhcccccc
Q 000417         1019 HKKGIRFYAYKLKSGRLSRPRFK 1041 (1534)
Q Consensus      1019 YkC~iC~K~F~sks~L~rH~r~H 1041 (1534)
                      |+|+.|++... +..|.+|++.|
T Consensus         1 y~C~~C~y~t~-~~~l~~H~~~~   22 (24)
T PF13909_consen    1 YKCPHCSYSTS-KSNLKRHLKRH   22 (24)
T ss_dssp             EE-SSSS-EES-HHHHHHHHHHH
T ss_pred             CCCCCCCCcCC-HHHHHHHHHhh
Confidence            34455554444 44455554443


No 71 
>PF11722 zf-TRM13_CCCH:  CCCH zinc finger in TRM13 protein;  InterPro: IPR021721  This domain is found at the N terminus of TRM13 methyltransferase proteins. It is presumed to be a zinc binding domain. ; GO: 0008168 methyltransferase activity
Probab=85.64  E-value=0.24  Score=39.45  Aligned_cols=29  Identities=28%  Similarity=0.619  Sum_probs=27.0

Q ss_pred             ccchhhhhhcCCceeeeecCCceEEEEee
Q 000417          533 RQCTAFIESKGRQCVRWANEGDVYCCVHL  561 (1534)
Q Consensus       533 ~~c~a~~~~k~r~c~r~a~~~~~yc~~h~  561 (1534)
                      -+|.-||+.|.|.|.-.+..|..||--|+
T Consensus         2 ~~C~f~l~~K~R~C~m~~~~g~~fC~~H~   30 (31)
T PF11722_consen    2 GRCEFFLPRKKRFCKMTRKPGSRFCGEHM   30 (31)
T ss_pred             CcceEECCccccccCCeecCcCCccccCC
Confidence            37999999999999999999999999885


No 72 
>PF12874 zf-met:  Zinc-finger of C2H2 type; PDB: 1ZU1_A 2KVG_A.
Probab=85.28  E-value=0.26  Score=36.54  Aligned_cols=19  Identities=5%  Similarity=-0.127  Sum_probs=8.5

Q ss_pred             ccCCCCcccCCchhhhccc
Q 000417         1020 KKGIRFYAYKLKSGRLSRP 1038 (1534)
Q Consensus      1020 kC~iC~K~F~sks~L~rH~ 1038 (1534)
                      .|.+|++.|.+...|..|+
T Consensus         2 ~C~~C~~~f~s~~~~~~H~   20 (25)
T PF12874_consen    2 YCDICNKSFSSENSLRQHL   20 (25)
T ss_dssp             EETTTTEEESSHHHHHHHH
T ss_pred             CCCCCCCCcCCHHHHHHHH
Confidence            3444444444444444444


No 73 
>PF12874 zf-met:  Zinc-finger of C2H2 type; PDB: 1ZU1_A 2KVG_A.
Probab=85.09  E-value=0.4  Score=35.52  Aligned_cols=20  Identities=35%  Similarity=0.808  Sum_probs=10.2

Q ss_pred             ccCccCcccCChHHHHhHhh
Q 000417          883 ACAICLDSFTNKKVLESHVQ  902 (1534)
Q Consensus       883 kC~~CgKsF~sks~L~~H~r  902 (1534)
                      .|.+|++.|.+...|..|++
T Consensus         2 ~C~~C~~~f~s~~~~~~H~~   21 (25)
T PF12874_consen    2 YCDICNKSFSSENSLRQHLR   21 (25)
T ss_dssp             EETTTTEEESSHHHHHHHHT
T ss_pred             CCCCCCCCcCCHHHHHHHHC
Confidence            35555555555555555544


No 74 
>PF13909 zf-H2C2_5:  C2H2-type zinc-finger domain; PDB: 1X5W_A.
Probab=83.95  E-value=0.63  Score=34.34  Aligned_cols=23  Identities=35%  Similarity=0.689  Sum_probs=10.2

Q ss_pred             cccCccCcccCChHHHHhHhhhcc
Q 000417          882 YACAICLDSFTNKKVLESHVQERH  905 (1534)
Q Consensus       882 ykC~~CgKsF~sks~L~~H~r~Hh  905 (1534)
                      |+|+.|+.... +..|.+|++.||
T Consensus         1 y~C~~C~y~t~-~~~l~~H~~~~H   23 (24)
T PF13909_consen    1 YKCPHCSYSTS-KSNLKRHLKRHH   23 (24)
T ss_dssp             EE-SSSS-EES-HHHHHHHHHHHH
T ss_pred             CCCCCCCCcCC-HHHHHHHHHhhC
Confidence            34555555444 445555554443


No 75 
>KOG4173 consensus Alpha-SNAP protein [Intracellular trafficking, secretion, and vesicular transport]
Probab=83.60  E-value=0.42  Score=52.83  Aligned_cols=91  Identities=22%  Similarity=0.296  Sum_probs=67.5

Q ss_pred             CccccCc--cCcccCChHHHHhHhhhcccccccccccccccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccC
Q 000417          880 RGYACAI--CLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVG  957 (1534)
Q Consensus       880 kpykC~~--CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~g  957 (1534)
                      +.|.|++  |-..|..-.....|..+.|+.         .|..|.+.|.+...|..|+...|..-         |.    
T Consensus        78 ~~~~cqvagc~~~~d~lD~~E~hY~~~h~~---------sCs~C~r~~Pt~hLLd~HI~E~HDs~---------Fq----  135 (253)
T KOG4173|consen   78 PAFACQVAGCCQVFDALDDYEHHYHTLHGN---------SCSFCKRAFPTGHLLDAHILEWHDSL---------FQ----  135 (253)
T ss_pred             ccccccccchHHHHhhhhhHHHhhhhcccc---------hhHHHHHhCCchhhhhHHHHHHHHHH---------HH----
Confidence            4577887  778888888888887666665         39999999999999999987777510         00    


Q ss_pred             CCCCccccCCCchhhhhhhhhcCCcceeee--cccCCccCChhHHHHHHHhhccC
Q 000417          958 EDSPKKLELGYSASVENHSENLGSIRKFIC--RFCGLKFDLLPDLGRHHQAAHMG 1010 (1534)
Q Consensus       958 eKp~~C~~Cgk~~sLk~HlrtHtgeKpykC--~~CgKsF~sks~LkrHH~rtHtg 1010 (1534)
                                        ..+-.|.--|+|  +.|+..|.+..+-+.|..++|.-
T Consensus       136 ------------------a~veRG~dMy~ClvEgCt~KFkT~r~RkdH~I~~Hk~  172 (253)
T KOG4173|consen  136 ------------------ALVERGQDMYQCLVEGCTEKFKTSRDRKDHMIRMHKY  172 (253)
T ss_pred             ------------------HHHHcCccHHHHHHHhhhhhhhhhhhhhhHHHHhccC
Confidence                              112234456888  66999999999988988888876


No 76 
>PF12171 zf-C2H2_jaz:  Zinc-finger double-stranded RNA-binding;  InterPro: IPR022755  This zinc finger is found in archaea and eukaryotes, and is approximately 30 amino acids in length. The mammalian members of this group occur multiple times along the protein, joined by flexible linkers, and are referred to as JAZ - dsRNA-binding ZF protein - zinc-fingers. The JAZ proteins are expressed in all tissues tested and localise in the nucleus, particularly the nucleolus []. JAZ preferentially binds to double-stranded (ds) RNA or RNA/DNA hybrids rather than DNA. In addition to binding double-stranded RNA, these zinc-fingers are required for nucleolar localisation.   This entry represents the multiple-adjacent-C2H2 zinc finger, JAZ. ; PDB: 4DGW_A 1ZR9_A.
Probab=83.60  E-value=0.64  Score=35.45  Aligned_cols=22  Identities=0%  Similarity=-0.277  Sum_probs=16.1

Q ss_pred             cccCCCCcccCCchhhhccccc
Q 000417         1019 HKKGIRFYAYKLKSGRLSRPRF 1040 (1534)
Q Consensus      1019 YkC~iC~K~F~sks~L~rH~r~ 1040 (1534)
                      |.|..|++.|.+...|..|++.
T Consensus         2 ~~C~~C~k~f~~~~~~~~H~~s   23 (27)
T PF12171_consen    2 FYCDACDKYFSSENQLKQHMKS   23 (27)
T ss_dssp             CBBTTTTBBBSSHHHHHCCTTS
T ss_pred             CCcccCCCCcCCHHHHHHHHcc
Confidence            5677777777777777777754


No 77 
>COG5236 Uncharacterized conserved protein, contains RING Zn-finger [General function prediction only]
Probab=83.44  E-value=0.62  Score=54.82  Aligned_cols=130  Identities=19%  Similarity=0.248  Sum_probs=73.7

Q ss_pred             ccccCc--cCcccCChHHHHhHhhhcccccccccccccccccCC---CccCChHHHhhhhhccccCcccchhhhhhcccc
Q 000417          881 GYACAI--CLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCG---SHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQS  955 (1534)
Q Consensus       881 pykC~~--CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~Cg---K~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~  955 (1534)
                      .|.|+.  |......-..|+.|.+..|+.        +.|.+|-   +.|...-.|-.                      
T Consensus       151 ~F~CP~skc~~~C~~~k~lk~H~K~~H~~--------~~C~~C~~nKk~F~~E~~lF~----------------------  200 (493)
T COG5236         151 SFKCPKSKCHRRCGSLKELKKHYKAQHGF--------VLCSECIGNKKDFWNEIRLFR----------------------  200 (493)
T ss_pred             HhcCCchhhhhhhhhHHHHHHHHHhhcCc--------EEhHhhhcCcccCccceeeee----------------------
Confidence            467764  666666677888898877765        4588774   23332211110                      


Q ss_pred             cCCCCCccccCCCchhhhhhhhhcCCc---c-eeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcc----
Q 000417          956 VGEDSPKKLELGYSASVENHSENLGSI---R-KFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYA---- 1027 (1534)
Q Consensus       956 ~geKp~~C~~Cgk~~sLk~HlrtHtge---K-pykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~---- 1027 (1534)
                                   ...|..|...-..+   | .-.|.+|.+.|..-..|.+|.+..|..          |.+|++.    
T Consensus       201 -------------~~~Lr~H~~~G~~e~GFKGHP~C~FC~~~FYdDDEL~~HcR~~HE~----------ChICD~v~p~~  257 (493)
T COG5236         201 -------------SSTLRDHKNGGLEEEGFKGHPLCIFCKIYFYDDDELRRHCRLRHEA----------CHICDMVGPIR  257 (493)
T ss_pred             -------------cccccccccCCccccCcCCCchhhhccceecChHHHHHHHHhhhhh----------hhhhhccCccc
Confidence                         11233333221111   1 235888888888888888855555543          6666543    


Q ss_pred             ---cCCchhhhcccccccCCCCccCC--CCC----CcCCChHHHHhhcc
Q 000417         1028 ---YKLKSGRLSRPRFKKGLGAVSYR--IRN----RGAAGMKKRIQTLK 1067 (1534)
Q Consensus      1028 ---F~sks~L~rH~r~H~gekpy~C~--iCg----ksFs~~~~L~kH~K 1067 (1534)
                         |+.-..|..|.+.-|    |.|.  .|.    ..|..-..|+.|.-
T Consensus       258 ~QYFK~Y~~Le~HF~~~h----y~ct~qtc~~~k~~vf~~~~el~~h~~  302 (493)
T COG5236         258 YQYFKSYEDLEAHFRNAH----YCCTFQTCRVGKCYVFPYHTELLEHLT  302 (493)
T ss_pred             hhhhhCHHHHHHHhhcCc----eEEEEEEEecCcEEEeccHHHHHHHHH
Confidence               667777777774322    3331  121    34566667777753


No 78 
>smart00570 AWS associated with SET domains. subdomain of PRESET
Probab=82.05  E-value=0.54  Score=41.69  Aligned_cols=24  Identities=33%  Similarity=0.830  Sum_probs=21.4

Q ss_pred             ceEEecCCCCCCCCCCCCcccccC
Q 000417         1353 YLIYECNHMCSCDRTCPNRVLQNG 1376 (1534)
Q Consensus      1353 ~~IyECn~~C~C~~~C~NRvvQ~g 1376 (1534)
                      .+.+||++.|.|+..|.||.+|+.
T Consensus        26 ~l~~EC~~~C~~G~~C~NqrFqk~   49 (51)
T smart00570       26 MLLIECSSDCPCGSYCSNQRFQKR   49 (51)
T ss_pred             HHhhhcCCCCCCCcCccCcccccC
Confidence            356899999999999999999975


No 79 
>KOG4173 consensus Alpha-SNAP protein [Intracellular trafficking, secretion, and vesicular transport]
Probab=81.23  E-value=0.44  Score=52.68  Aligned_cols=87  Identities=24%  Similarity=0.526  Sum_probs=68.8

Q ss_pred             CCcccCCC--CCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhccccccc----cccccccc
Q 000417          845 EKTHKCKI--CSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFV----EQCMLQQC  918 (1534)
Q Consensus       845 ekpykC~~--CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~----~~~kpykC  918 (1534)
                      -+.|.|++  |...|.....+..|.-..|+..         |..|.+.|.+...|..|+...|..-+.    .+.-.|+|
T Consensus        77 ~~~~~cqvagc~~~~d~lD~~E~hY~~~h~~s---------Cs~C~r~~Pt~hLLd~HI~E~HDs~Fqa~veRG~dMy~C  147 (253)
T KOG4173|consen   77 VPAFACQVAGCCQVFDALDDYEHHYHTLHGNS---------CSFCKRAFPTGHLLDAHILEWHDSLFQALVERGQDMYQC  147 (253)
T ss_pred             cccccccccchHHHHhhhhhHHHhhhhcccch---------hHHHHHhCCchhhhhHHHHHHHHHHHHHHHHcCccHHHH
Confidence            35688886  8899999999999965666654         999999999999999999866643110    01146889


Q ss_pred             c--cCCCccCChHHHhhhhhcccc
Q 000417          919 I--PCGSHFGNTEELWLHVQSVHA  940 (1534)
Q Consensus       919 ~--~CgK~Fssk~~Lk~H~~rvH~  940 (1534)
                      -  -|+..|.+...-+.|+.+.|.
T Consensus       148 lvEgCt~KFkT~r~RkdH~I~~Hk  171 (253)
T KOG4173|consen  148 LVEGCTEKFKTSRDRKDHMIRMHK  171 (253)
T ss_pred             HHHhhhhhhhhhhhhhhHHHHhcc
Confidence            4  599999999999999989996


No 80 
>KOG2785 consensus C2H2-type Zn-finger protein [General function prediction only]
Probab=80.36  E-value=2.4  Score=51.22  Aligned_cols=26  Identities=27%  Similarity=0.354  Sum_probs=18.1

Q ss_pred             eeeecccCCccCChhHHHHHHHhhccC
Q 000417          984 KFICRFCGLKFDLLPDLGRHHQAAHMG 1010 (1534)
Q Consensus       984 pykC~~CgKsF~sks~LkrHH~rtHtg 1010 (1534)
                      |-.|-.|++.|.+...-.+ ||..|+|
T Consensus       166 Pt~CLfC~~~~k~~e~~~~-HM~~~Hg  191 (390)
T KOG2785|consen  166 PTDCLFCDKKSKSLEENLK-HMFKEHG  191 (390)
T ss_pred             CcceeecCCCcccHHHHHH-HHhhccC
Confidence            4567788888887777777 5555555


No 81 
>KOG2482 consensus Predicted C2H2-type Zn-finger protein [Transcription]
Probab=79.56  E-value=3.1  Score=49.42  Aligned_cols=26  Identities=23%  Similarity=0.300  Sum_probs=22.7

Q ss_pred             eeecccCCccCChhHHHHHHHhhccC
Q 000417          985 FICRFCGLKFDLLPDLGRHHQAAHMG 1010 (1534)
Q Consensus       985 ykC~~CgKsF~sks~LkrHH~rtHtg 1010 (1534)
                      .+|-.|.....+...|..|+..+|.=
T Consensus       280 v~CLfC~~~~en~~~l~eHmk~vHe~  305 (423)
T KOG2482|consen  280 VVCLFCTNFYENPVFLFEHMKIVHEF  305 (423)
T ss_pred             eEEEeeccchhhHHHHHHHHHHHHHh
Confidence            69999999999999999987778853


No 82 
>KOG2084 consensus Predicted histone tail methylase containing SET domain [Chromatin structure and dynamics]
Probab=79.15  E-value=2.3  Score=52.79  Aligned_cols=53  Identities=38%  Similarity=0.729  Sum_probs=38.2

Q ss_pred             ccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCC-eEEEEcCCCCCCC----------CCceeeCCC
Q 000417         1466 FINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGE-ELTYDYHYELLSG----------EGYPCHCGA 1526 (1534)
Q Consensus      1466 FINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGE-ELT~DYg~~~~~~----------~~~~C~CGS 1526 (1534)
                      ++||||.||+.+   ..+     .....+.+..++.+++ ||++.|....++.          ..|.|.|+.
T Consensus       208 ~~~hsC~pn~~~---~~~-----~~~~~~~~~~~~~~~~~~l~~~y~~~~~~~~~r~~~l~~~~~f~c~c~r  271 (482)
T KOG2084|consen  208 LFNHSCFPNISV---IFD-----GRGLALLVPAGIDAGEEELTISYTDPLLSTASRQKQLRQSKLFSCQCPR  271 (482)
T ss_pred             hcccCCCCCeEE---EEC-----CceeEEEeecccCCCCCEEEEeecccccCHHHHHHHHhhccceeeecCC
Confidence            779999999982   222     2346677888888887 9999998876542          136777764


No 83 
>PF12171 zf-C2H2_jaz:  Zinc-finger double-stranded RNA-binding;  InterPro: IPR022755  This zinc finger is found in archaea and eukaryotes, and is approximately 30 amino acids in length. The mammalian members of this group occur multiple times along the protein, joined by flexible linkers, and are referred to as JAZ - dsRNA-binding ZF protein - zinc-fingers. The JAZ proteins are expressed in all tissues tested and localise in the nucleus, particularly the nucleolus []. JAZ preferentially binds to double-stranded (ds) RNA or RNA/DNA hybrids rather than DNA. In addition to binding double-stranded RNA, these zinc-fingers are required for nucleolar localisation.   This entry represents the multiple-adjacent-C2H2 zinc finger, JAZ. ; PDB: 4DGW_A 1ZR9_A.
Probab=78.27  E-value=1.1  Score=34.10  Aligned_cols=21  Identities=24%  Similarity=0.695  Sum_probs=11.4

Q ss_pred             cccCccCcccCChHHHHhHhh
Q 000417          882 YACAICLDSFTNKKVLESHVQ  902 (1534)
Q Consensus       882 ykC~~CgKsF~sks~L~~H~r  902 (1534)
                      |.|..|++.|.+...|..|++
T Consensus         2 ~~C~~C~k~f~~~~~~~~H~~   22 (27)
T PF12171_consen    2 FYCDACDKYFSSENQLKQHMK   22 (27)
T ss_dssp             CBBTTTTBBBSSHHHHHCCTT
T ss_pred             CCcccCCCCcCCHHHHHHHHc
Confidence            445555555555555555554


No 84 
>KOG2482 consensus Predicted C2H2-type Zn-finger protein [Transcription]
Probab=75.13  E-value=2.8  Score=49.78  Aligned_cols=23  Identities=9%  Similarity=-0.123  Sum_probs=17.6

Q ss_pred             CcccCCCCcccCCchhhhccccc
Q 000417         1018 PHKKGIRFYAYKLKSGRLSRPRF 1040 (1534)
Q Consensus      1018 pYkC~iC~K~F~sks~L~rH~r~ 1040 (1534)
                      .-.|-.|.-.|.....|..||.-
T Consensus       334 ~~~c~~cd~~F~~e~~l~~hm~e  356 (423)
T KOG2482|consen  334 KSRCAECDLSFWKEPGLLIHMVE  356 (423)
T ss_pred             ccccccccccccCcchhhhhccc
Confidence            34577777889999999999843


No 85 
>KOG2893 consensus Zn finger protein [General function prediction only]
Probab=69.43  E-value=1.8  Score=48.93  Aligned_cols=48  Identities=27%  Similarity=0.517  Sum_probs=38.8

Q ss_pred             ccCccCcccCChHHHHhHhhhcccccccccccccccccCCCccCChHHHhhhhhcccc
Q 000417          883 ACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNTEELWLHVQSVHA  940 (1534)
Q Consensus       883 kC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk~~Lk~H~~rvH~  940 (1534)
                      -|-+|++.|.....|.+|++..|          |+|.+|.|..-+-..|..|.+.+|.
T Consensus        12 wcwycnrefddekiliqhqkakh----------fkchichkkl~sgpglsihcmqvhk   59 (341)
T KOG2893|consen   12 WCWYCNREFDDEKILIQHQKAKH----------FKCHICHKKLFSGPGLSIHCMQVHK   59 (341)
T ss_pred             eeeecccccchhhhhhhhhhhcc----------ceeeeehhhhccCCCceeehhhhhh
Confidence            38899999999999999876544          6699999888888888888666664


No 86 
>cd05837 MSH6_like The PWWP domain is present in MSH6, a mismatch repair protein homologous to bacterial MutS.   The PWWP domain of histone-lysine N-methyltransferase, also known as Nuclear SET domain-containing protein 3, is also included. Mutations in MSH6 have been linked to increased cancer susceptibility, particularly in hereditary nonpolyposis colorectal cancer in humans.  The role of the PWWP domain in MSH6 is not clear; MSH6 orthologs found in S. cerevisiae, Caenorhabditis elegans and Arabidopsis thaliana lack the PWWP domain.   Histone methyltransferases (HMTases) induce the posttranslational methylation of lysine residues in histones and play a role in apoptosis.  In the HMTase Whistle, the PWWP domain is necessary for HMTase activity. The PWWP domain, named for a conserved Pro-Trp-Trp-Pro motif, is a small domain consisting of 100-150 amino acids. The PWWP domain is found in numerous proteins that are involved in cell division, growth and differentiation. Most PWWP-domain pro
Probab=64.82  E-value=6.9  Score=40.03  Aligned_cols=63  Identities=17%  Similarity=0.374  Sum_probs=45.8

Q ss_pred             EEEEEeccc-cccceeeeeccCCCccccccccCCCccEEEEEeccCCcchhhhhhccccccCCC
Q 000417          157 ALWVKWRGK-WQAGIRCARADWPLPTLKAKPTHDRKKYFVIFFPHTRNYSWADMLLVRSINEFP  219 (1534)
Q Consensus       157 ~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~  219 (1534)
                      -+|.|=+|- |--|+-+...+=|..+.+..+....+.|.|.||..+.+|.||.---+.++.+.-
T Consensus         8 lVWaK~~g~PwWPa~V~~~~~~~~~~~~~~~~~~~~~~~V~FFG~~~~~aWv~~~~l~pf~~~~   71 (110)
T cd05837           8 LVWAKVSGYPWWPCMVCSDPLLGTYTKTKRNKRKPRQYHVQFFGDNPERAWISEKSLKPFKGSK   71 (110)
T ss_pred             EEEEeCCCCCCCCEEEecccccchhhhhhhccCCCCeEEEEEcCCCCCEEEecHHHccccCCch
Confidence            479999884 666666654444444444445555689999999999999999988888877654


No 87 
>COG4049 Uncharacterized protein containing archaeal-type C2H2 Zn-finger [General function prediction only]
Probab=62.12  E-value=3.1  Score=37.35  Aligned_cols=35  Identities=20%  Similarity=0.318  Sum_probs=27.8

Q ss_pred             cccccCCCcccCCCCCcccCChhhHhhhhhcccCc
Q 000417          839 AGRSEDEKTHKCKICSQVFLHDQELGVHWMDNHKK  873 (1534)
Q Consensus       839 ~~~h~gekpykC~~CgK~F~sks~L~~H~~~~H~~  873 (1534)
                      .+...||..++||-|++.|.....+.+|+...|.-
T Consensus         9 v~~RDGE~~lrCPRC~~~FR~~K~Y~RHVNKaH~~   43 (65)
T COG4049           9 VRDRDGEEFLRCPRCGMVFRRRKDYIRHVNKAHGW   43 (65)
T ss_pred             eeccCCceeeeCCchhHHHHHhHHHHHHhhHHhhh
Confidence            35567788889999999999999999997666653


No 88 
>KOG2785 consensus C2H2-type Zn-finger protein [General function prediction only]
Probab=61.22  E-value=3.3  Score=50.05  Aligned_cols=172  Identities=12%  Similarity=0.065  Sum_probs=98.8

Q ss_pred             ccccCccCcccCChHHHHhHhhh--cccc--------cc---------------------cccccccccccCCCccCChH
Q 000417          881 GYACAICLDSFTNKKVLESHVQE--RHHV--------QF---------------------VEQCMLQQCIPCGSHFGNTE  929 (1534)
Q Consensus       881 pykC~~CgKsF~sks~L~~H~r~--Hh~e--------k~---------------------~~~~kpykC~~CgK~Fssk~  929 (1534)
                      .|+|.-|...|.+...-+.|+++  |...        .+                     .....++.|..|.+.|.+..
T Consensus         3 ~ftC~tC~v~F~~ad~Qr~HyKSdWHRYNLKRkVA~lPPItaE~F~~k~~s~~~~~~~~~e~~~~~~~c~~c~k~~~s~~   82 (390)
T KOG2785|consen    3 GFTCNTCNVEFDDADEQRAHYKSDWHRYNLKRKVASLPPITAEEFNEKVLSDDSEKEENLEEAESVVYCEACNKSFASPK   82 (390)
T ss_pred             cceeeceeeeeccHHHHHHHhhhhHHHhhHHhHhhcCCCcCHHHHhHHHhhhhhhhhhhhhhcccceehHHhhccccChh
Confidence            58999999999999999999985  3211        00                     01124789999999999999


Q ss_pred             HHhhhhhcc-ccCcccchhhhhhccc-ccCCCCC-ccccCCCchhhhhhhhhcCCcceeeecccCCccCChhHHHHHHHh
Q 000417          930 ELWLHVQSV-HAIDFKMSEVAQQHNQ-SVGEDSP-KKLELGYSASVENHSENLGSIRKFICRFCGLKFDLLPDLGRHHQA 1006 (1534)
Q Consensus       930 ~Lk~H~~rv-H~~ef~C~~C~k~f~~-~~geKp~-~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKsF~sks~LkrHH~r 1006 (1534)
                      ....|+... |...      +..|.+ ..+...- .-..+.+...     ..+.++   .+..+-..+........ +..
T Consensus        83 a~~~hl~Sk~h~~~------~~~~~r~~e~d~a~~~q~~~~~p~~-----l~~~~e---~e~~~~E~~~~~d~~~e-~~~  147 (390)
T KOG2785|consen   83 AHENHLKSKKHVEN------LSNHQRSEEGDSAKISQLPSRRPSN-----LQNKGE---SELKWYEVDSDEDSSEE-EEE  147 (390)
T ss_pred             hHHHHHHHhhcchh------hhhhhccccccchhhhhccccCccc-----cccCCC---cccchhhcccccccchh-hcc
Confidence            999995432 3211      111111 0000000 0000000000     001111   23333333333222222 111


Q ss_pred             hcc------CC-CCCCCCCcccCCCCcccCCchhhhcccccccCCC-----------------------CccCCCCC---
Q 000417         1007 AHM------GP-NLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGLG-----------------------AVSYRIRN--- 1053 (1534)
Q Consensus      1007 tHt------ge-~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~gek-----------------------py~C~iCg--- 1053 (1534)
                      .-.      .. .....-|-.|=+|++.|.+-..-..||..|||..                       .|.|-.|+   
T Consensus       148 dd~~Edi~~d~~~e~e~~Pt~CLfC~~~~k~~e~~~~HM~~~HgffIPdreYL~D~~GLl~YLgeKV~~~~~CL~CN~~~  227 (390)
T KOG2785|consen  148 DDEEEDIEEDGDDEDELIPTDCLFCDKKSKSLEENLKHMFKEHGFFIPDREYLTDEKGLLKYLGEKVGIGFICLFCNELG  227 (390)
T ss_pred             CcchhhhhhccchhcccCCcceeecCCCcccHHHHHHHHhhccCCcCCchHhhhchhHHHHHHHHHhccCceEEEecccc
Confidence            100      00 0111346889999999999999999999999862                       27788888   


Q ss_pred             CcCCChHHHHhhcc
Q 000417         1054 RGAAGMKKRIQTLK 1067 (1534)
Q Consensus      1054 ksFs~~~~L~kH~K 1067 (1534)
                      +.|.++.+.++||.
T Consensus       228 ~~f~sleavr~HM~  241 (390)
T KOG2785|consen  228 RPFSSLEAVRAHMR  241 (390)
T ss_pred             CcccccHHHHHHHh
Confidence            99999999999986


No 89 
>smart00451 ZnF_U1 U1-like zinc finger. Family of C2H2-type zinc fingers, present in matrin, U1 small nuclear ribonucleoprotein C and other RNA-binding proteins.
Probab=57.89  E-value=6.2  Score=31.45  Aligned_cols=25  Identities=28%  Similarity=0.781  Sum_probs=17.3

Q ss_pred             ccccCccCcccCChHHHHhHhhhcc
Q 000417          881 GYACAICLDSFTNKKVLESHVQERH  905 (1534)
Q Consensus       881 pykC~~CgKsF~sks~L~~H~r~Hh  905 (1534)
                      +|.|..|++.|.+...+..|++...
T Consensus         3 ~~~C~~C~~~~~~~~~~~~H~~gk~   27 (35)
T smart00451        3 GFYCKLCNVTFTDEISVEAHLKGKK   27 (35)
T ss_pred             CeEccccCCccCCHHHHHHHHChHH
Confidence            4667777777777777777766443


No 90 
>KOG2893 consensus Zn finger protein [General function prediction only]
Probab=57.54  E-value=3.3  Score=46.85  Aligned_cols=47  Identities=23%  Similarity=0.236  Sum_probs=34.6

Q ss_pred             ecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhccc-ccccC
Q 000417          987 CRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRP-RFKKG 1043 (1534)
Q Consensus       987 C~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~-r~H~g 1043 (1534)
                      |-+|++.|....-|.+| ++         .|-|+|.+|.|...+--.|..|- .+|+.
T Consensus        13 cwycnrefddekiliqh-qk---------akhfkchichkkl~sgpglsihcmqvhke   60 (341)
T KOG2893|consen   13 CWYCNREFDDEKILIQH-QK---------AKHFKCHICHKKLFSGPGLSIHCMQVHKE   60 (341)
T ss_pred             eeecccccchhhhhhhh-hh---------hccceeeeehhhhccCCCceeehhhhhhh
Confidence            78888888888888773 32         45688888888887777888775 55543


No 91 
>KOG1337 consensus N-methyltransferase [General function prediction only]
Probab=56.30  E-value=8  Score=48.96  Aligned_cols=40  Identities=30%  Similarity=0.368  Sum_probs=30.9

Q ss_pred             ccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCC
Q 000417         1466 FINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHY 1512 (1534)
Q Consensus      1466 FINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~ 1512 (1534)
                      +.||++++.    ...++..|   ..+-+++.++|.+|||+++.||.
T Consensus       239 ~~NH~~~~~----~~~~~~~d---~~~~l~~~~~v~~geevfi~YG~  278 (472)
T KOG1337|consen  239 LLNHSPEVI----KAGYNQED---EAVELVAERDVSAGEEVFINYGP  278 (472)
T ss_pred             hhccCchhc----cccccCCC---CcEEEEEeeeecCCCeEEEecCC
Confidence            579999992    22333323   37889999999999999999996


No 92 
>PF13913 zf-C2HC_2:  zinc-finger of a C2HC-type
Probab=55.07  E-value=9  Score=29.11  Aligned_cols=18  Identities=44%  Similarity=0.805  Sum_probs=9.8

Q ss_pred             ccCccCcccCChHHHHhHh
Q 000417          883 ACAICLDSFTNKKVLESHV  901 (1534)
Q Consensus       883 kC~~CgKsF~sks~L~~H~  901 (1534)
                      .|+.|++.| ....|.+|+
T Consensus         4 ~C~~CgR~F-~~~~l~~H~   21 (25)
T PF13913_consen    4 PCPICGRKF-NPDRLEKHE   21 (25)
T ss_pred             cCCCCCCEE-CHHHHHHHH
Confidence            455555555 445555554


No 93 
>smart00451 ZnF_U1 U1-like zinc finger. Family of C2H2-type zinc fingers, present in matrin, U1 small nuclear ribonucleoprotein C and other RNA-binding proteins.
Probab=54.51  E-value=4.6  Score=32.18  Aligned_cols=21  Identities=0%  Similarity=-0.236  Sum_probs=12.4

Q ss_pred             CcccCCCCcccCCchhhhccc
Q 000417         1018 PHKKGIRFYAYKLKSGRLSRP 1038 (1534)
Q Consensus      1018 pYkC~iC~K~F~sks~L~rH~ 1038 (1534)
                      +|.|++|++.|.....+..|+
T Consensus         3 ~~~C~~C~~~~~~~~~~~~H~   23 (35)
T smart00451        3 GFYCKLCNVTFTDEISVEAHL   23 (35)
T ss_pred             CeEccccCCccCCHHHHHHHH
Confidence            455666666666555555555


No 94 
>PF13913 zf-C2HC_2:  zinc-finger of a C2HC-type
Probab=51.27  E-value=10  Score=28.87  Aligned_cols=17  Identities=35%  Similarity=0.682  Sum_probs=12.5

Q ss_pred             eeecccCCccCChhHHHH
Q 000417          985 FICRFCGLKFDLLPDLGR 1002 (1534)
Q Consensus       985 ykC~~CgKsF~sks~Lkr 1002 (1534)
                      ..|+.||+.| ....|.+
T Consensus         3 ~~C~~CgR~F-~~~~l~~   19 (25)
T PF13913_consen    3 VPCPICGRKF-NPDRLEK   19 (25)
T ss_pred             CcCCCCCCEE-CHHHHHH
Confidence            4688888888 6667777


No 95 
>COG0068 HypF Hydrogenase maturation factor [Posttranslational modification, protein turnover, chaperones]
Probab=47.90  E-value=6.9  Score=50.89  Aligned_cols=13  Identities=0%  Similarity=-0.048  Sum_probs=7.0

Q ss_pred             ccchhhhhhcccc
Q 000417          943 FKMSEVAQQHNQS  955 (1534)
Q Consensus       943 f~C~~C~k~f~~~  955 (1534)
                      -.|+.|.+.....
T Consensus       102 a~C~~Cl~Ei~dp  114 (750)
T COG0068         102 ATCEDCLEEIFDP  114 (750)
T ss_pred             hhhHHHHHHhcCC
Confidence            3566666555443


No 96 
>COG4049 Uncharacterized protein containing archaeal-type C2H2 Zn-finger [General function prediction only]
Probab=43.76  E-value=10  Score=34.17  Aligned_cols=33  Identities=27%  Similarity=0.334  Sum_probs=26.8

Q ss_pred             hcCCcceeeecccCCccCChhHHHHHHHhhccC
Q 000417          978 NLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMG 1010 (1534)
Q Consensus       978 tHtgeKpykC~~CgKsF~sks~LkrHH~rtHtg 1010 (1534)
                      .-.||.-++|+.||+.|....+..+|.-+.|.-
T Consensus        11 ~RDGE~~lrCPRC~~~FR~~K~Y~RHVNKaH~~   43 (65)
T COG4049          11 DRDGEEFLRCPRCGMVFRRRKDYIRHVNKAHGW   43 (65)
T ss_pred             ccCCceeeeCCchhHHHHHhHHHHHHhhHHhhh
Confidence            345777889999999999999999977777754


No 97 
>KOG3813 consensus Uncharacterized conserved protein (tumor-suppressor AXUD1 in humans) [General function prediction only]
Probab=40.68  E-value=13  Score=46.60  Aligned_cols=19  Identities=42%  Similarity=1.027  Sum_probs=16.6

Q ss_pred             CCCcccCCCCcCCCCCCccc
Q 000417         1299 QLGCACANSTCFPETCDHVY 1318 (1534)
Q Consensus      1299 ~~GC~C~~~~C~p~~C~C~~ 1318 (1534)
                      -+||+|. +.|+|++|.|.+
T Consensus       307 eCGCsCr-~~CdPETCaCSq  325 (640)
T KOG3813|consen  307 ECGCSCR-GVCDPETCACSQ  325 (640)
T ss_pred             hhCCccc-ceeChhhcchhc
Confidence            4899999 699999999964


No 98 
>PF12013 DUF3505:  Protein of unknown function (DUF3505);  InterPro: IPR022698  This family of proteins is functionally uncharacterised. This protein is found in eukaryotes. Proteins in this family are typically between 247 to 1018 amino acids in length. This region contains two segments that are likely to be C2H2 zinc binding domains. 
Probab=39.71  E-value=34  Score=34.68  Aligned_cols=27  Identities=15%  Similarity=-0.070  Sum_probs=19.5

Q ss_pred             CCccc----CCCCcccCCchhhhcccccccC
Q 000417         1017 RPHKK----GIRFYAYKLKSGRLSRPRFKKG 1043 (1534)
Q Consensus      1017 KpYkC----~iC~K~F~sks~L~rH~r~H~g 1043 (1534)
                      ..|.|    ..|++.+.+...+++|.+.+||
T Consensus        79 ~G~~C~~~~~~C~y~~~~~~~m~~H~~~~Hg  109 (109)
T PF12013_consen   79 DGYRCQCDPPHCGYITRSKKTMRKHWRKEHG  109 (109)
T ss_pred             CCeeeecCCCCCCcEeccHHHHHHHHHHhcC
Confidence            34777    7777777777777777776654


No 99 
>smart00293 PWWP domain with conserved PWWP motif. conservation of Pro-Trp-Trp-Pro residues
Probab=39.58  E-value=32  Score=31.62  Aligned_cols=56  Identities=20%  Similarity=0.433  Sum_probs=38.5

Q ss_pred             EEEEEecc-ccccceeeeeccCCCccccccccCCCccEEEEEeccCCcchhhhhhccccc
Q 000417          157 ALWVKWRG-KWQAGIRCARADWPLPTLKAKPTHDRKKYFVIFFPHTRNYSWADMLLVRSI  215 (1534)
Q Consensus       157 ~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~  215 (1534)
                      -+|.|=+| -|--|+-+...+-|...++  +.-....|.|.||.. .+|.|++--.+.++
T Consensus         6 lVwaK~~G~p~WPa~V~~~~~~~~~~~~--~~~~~~~~~V~Ffg~-~~~awv~~~~l~p~   62 (63)
T smart00293        6 LVWAKMKGFPWWPALVVSPKETPDNIRK--RKRFENLYPVLFFGD-KDTAWISSSKLFPL   62 (63)
T ss_pred             EEEEECCCCCCCCeEEcCcccCChhHhh--ccCCCCEEEEEEeCC-CCEEEECccceeeC
Confidence            37999999 7777777766665554332  334456788888875 55699987766554


No 100
>PF00855 PWWP:  PWWP domain;  InterPro: IPR000313 Upon characterisation of WHSC1, a gene mapping to the Wolf-Hirschhornsyndrome critical region and at its C terminus similar to the Drosophila melanogaster ASH1/trithorax group proteins, a novel protein domain designated PWWP domain was identified []. The PWWP domain is named after a conserved Pro-Trp-Trp-Pro motif. It is present in proteins of nuclear origin and plays a role in cell growth and differentiation. Due to its position, the composition of amino acids close to the PWWP motif and the pattern of other domains present it has been suggested that the domain is involved in protein-protein interactions [].; PDB: 3LYI_B 2L89_A 2NLU_A 1RI0_A 1KHC_A 3QKJ_C 2DAQ_A 1N27_A 3PFS_B 3QJ6_A ....
Probab=38.32  E-value=31  Score=32.93  Aligned_cols=56  Identities=23%  Similarity=0.577  Sum_probs=38.4

Q ss_pred             EEEEEecc-ccccceeeeeccCCCccccccccCCCccEEEEEeccCCcchhhhhhccccccCCC
Q 000417          157 ALWVKWRG-KWQAGIRCARADWPLPTLKAKPTHDRKKYFVIFFPHTRNYSWADMLLVRSINEFP  219 (1534)
Q Consensus       157 ~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~  219 (1534)
                      -+|+|=+| -|=-|+=|...+.+-     + ......|.|.||... +|.|++.-.|.+.+++-
T Consensus         6 lVWaK~~g~pwWPa~V~~~~~~~~-----~-~~~~~~~~V~Ffg~~-~~~wv~~~~i~~f~~~~   62 (86)
T PF00855_consen    6 LVWAKLKGYPWWPARVCDPDEKSK-----K-KRKDGHVLVRFFGDN-DYAWVKPSNIKPFSEFK   62 (86)
T ss_dssp             EEEEEETTSEEEEEEEEECCHCTS-----C-SSSSTEEEEEETTTT-EEEEEEGGGEEECCHHH
T ss_pred             EEEEEeCCCCCCceEEeecccccc-----c-CCCCCEEEEEecCCC-CEEEECHHHhhChhhhH
Confidence            48999987 355666666664443     1 334466777777766 99999998888877544


No 101
>cd00350 rubredoxin_like Rubredoxin_like; nonheme iron binding domain containing a [Fe(SCys)4] center. The family includes rubredoxins, a small electron transfer protein, and a slightly smaller modular rubredoxin domain present in rubrerythrin and nigerythrin and detected either N- or C-terminal to such proteins as flavin reductase, NAD(P)H-nitrite reductase, and ferredoxin-thioredoxin reductase. In rubredoxin, the iron atom is coordinated by four cysteine residues (Fe(S-Cys)4), but iron can also be replaced by cobalt, nickel or zinc and believed to be involved in electron transfer.  Rubrerythrins and nigerythrins are small homodimeric proteins, generally consisting of 2 domains: a rubredoxin domain C-terminal to a non-sulfur, oxo-bridged diiron site in the N-terminal rubrerythrin domain.  Rubrerythrins and nigerythrins have putative peroxide activity.
Probab=37.12  E-value=23  Score=28.64  Aligned_cols=10  Identities=0%  Similarity=-0.114  Sum_probs=4.9

Q ss_pred             CCccCCCCCC
Q 000417         1045 GAVSYRIRNR 1054 (1534)
Q Consensus      1045 kpy~C~iCgk 1054 (1534)
                      .+..|++|+.
T Consensus        16 ~~~~CP~Cg~   25 (33)
T cd00350          16 APWVCPVCGA   25 (33)
T ss_pred             CCCcCcCCCC
Confidence            3445555543


No 102
>COG1198 PriA Primosomal protein N' (replication factor Y) - superfamily II helicase [DNA replication, recombination, and repair]
Probab=36.76  E-value=17  Score=48.35  Aligned_cols=42  Identities=21%  Similarity=0.180  Sum_probs=25.9

Q ss_pred             CCCccccchhhhchhhhhhhhhhhhh-cCCCCCccccccccccc
Q 000417         1112 PNSHEILSMARLACCKVSLKASLEEK-YGALPENICLKAAKLCS 1154 (1534)
Q Consensus      1112 Psn~dIls~a~s~CcK~~l~asL~~k-~g~lpe~l~lkaakLcs 1154 (1534)
                      |.+..|..+-.. =.-+|..+.|+.+ -..+||--++-+....+
T Consensus       603 P~hp~i~~~~~~-dy~~F~~~El~~Rk~~~~PPf~~l~~v~~~~  645 (730)
T COG1198         603 PDHPAIQALKRG-DYEAFYEQELAERKELGLPPFSRLAAVIASA  645 (730)
T ss_pred             CCcHHHHHHHhc-CHHHHHHHHHHHHHhcCCCChhhheeeEecC
Confidence            544444444333 2335888888877 68889888877554433


No 103
>PF09538 FYDLN_acid:  Protein of unknown function (FYDLN_acid);  InterPro: IPR012644 Members of this family are bacterial proteins with a conserved motif [KR]FYDLN, sometimes flanked by a pair of CXXC motifs, followed by a long region of low complexity sequence in which roughly half the residues are Asp and Glu, including multiple runs of five or more acidic residues. The function of members of this family is unknown.
Probab=36.16  E-value=18  Score=37.09  Aligned_cols=30  Identities=23%  Similarity=0.222  Sum_probs=18.7

Q ss_pred             eeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCc
Q 000417          985 FICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLK 1031 (1534)
Q Consensus       985 ykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sk 1031 (1534)
                      ..|+.||++|.-   |+              ..|-.|++||..|.-.
T Consensus        10 R~Cp~CG~kFYD---Ln--------------k~PivCP~CG~~~~~~   39 (108)
T PF09538_consen   10 RTCPSCGAKFYD---LN--------------KDPIVCPKCGTEFPPE   39 (108)
T ss_pred             ccCCCCcchhcc---CC--------------CCCccCCCCCCccCcc
Confidence            467777777753   21              2466677777777655


No 104
>TIGR02098 MJ0042_CXXC MJ0042 family finger-like domain. This domain contains a CXXCX(19)CXXC motif suggestive of both zinc fingers and thioredoxin, usually found at the N-terminus of prokaryotic proteins. One partially characterized gene, agmX, is among a large set in Myxococcus whose interruption affects adventurous gliding motility.
Probab=35.21  E-value=19  Score=29.60  Aligned_cols=34  Identities=12%  Similarity=0.123  Sum_probs=17.7

Q ss_pred             eeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccC
Q 000417          985 FICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYK 1029 (1534)
Q Consensus       985 ykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~ 1029 (1534)
                      ++|+.|+..|.-..+...      ..     .....|+.|+..|.
T Consensus         3 ~~CP~C~~~~~v~~~~~~------~~-----~~~v~C~~C~~~~~   36 (38)
T TIGR02098         3 IQCPNCKTSFRVVDSQLG------AN-----GGKVRCGKCGHVWY   36 (38)
T ss_pred             EECCCCCCEEEeCHHHcC------CC-----CCEEECCCCCCEEE
Confidence            456667666655544321      01     12456666666553


No 105
>cd05838 WHSC1_related The PWWP domain was first identified in the WHSC1 (Wolf-Hirschhorn syndrome candidate 1) protein, a protein implicated in Wolf-Hirschhorn syndrome (WHS).  When translocated, WHSC1 plays a role in lymphoid multiple myeloma (MM) disease, also known as plasmacytoma. WHCS1 proteins typically contain two copies of the PWWP domain.  The PWWP domain, named for a conserved Pro-Trp-Trp-Pro motif, is a small domain consisting of 100-150 amino acids. The PWWP domain is found in numerous proteins that are involved in cell division, growth and differentiation. Most PWWP-domain proteins seem to be nuclear, often DNA-binding, proteins that function as transcription factors regulating a variety of developmental processes.
Probab=35.04  E-value=30  Score=34.59  Aligned_cols=54  Identities=26%  Similarity=0.543  Sum_probs=34.0

Q ss_pred             EEEEecc-ccccceeeeeccCCCccccccccCCCccEEEEEeccCCcchhhhhhcccc
Q 000417          158 LWVKWRG-KWQAGIRCARADWPLPTLKAKPTHDRKKYFVIFFPHTRNYSWADMLLVRS  214 (1534)
Q Consensus       158 ~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~  214 (1534)
                      +|+|-+| -|=-|+-|-..+=|-..+..+  +....|.|.|| .+++|.|++--.|-+
T Consensus         7 VWaK~~g~pwWPa~V~~~~~~p~~~~~~~--~~~~~~~V~Ff-gs~~y~Wv~~~~l~p   61 (95)
T cd05838           7 VWAKLGNFRWWPAIICDPREVPPNIQVLR--HCIGEFCVMFF-GTHDYYWVHRGRVFP   61 (95)
T ss_pred             EEEECCCCCCCCeEEcChhhcChhHhhcc--CCCCeEEEEEe-CCCCEEEeccccccc
Confidence            7999998 455666665543333222211  23356888888 589999999744443


No 106
>TIGR00373 conserved hypothetical protein TIGR00373. This family of proteins is, so far, restricted to archaeal genomes. The family appears to be distantly related to the N-terminal region of the eukaryotic transcription initiation factor IIE alpha chain.
Probab=34.47  E-value=26  Score=38.18  Aligned_cols=39  Identities=13%  Similarity=-0.030  Sum_probs=25.4

Q ss_pred             hhhhhcCCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcc
Q 000417          974 NHSENLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYA 1027 (1534)
Q Consensus       974 ~HlrtHtgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~ 1027 (1534)
                      .-+.......-|.|+.|+..|+...++..               .|.|+.||..
T Consensus        99 ~~l~~e~~~~~Y~Cp~c~~r~tf~eA~~~---------------~F~Cp~Cg~~  137 (158)
T TIGR00373        99 EKLEFETNNMFFICPNMCVRFTFNEAMEL---------------NFTCPRCGAM  137 (158)
T ss_pred             HHHhhccCCCeEECCCCCcEeeHHHHHHc---------------CCcCCCCCCE
Confidence            33344445566788888888777766632               4778888754


No 107
>PF09986 DUF2225:  Uncharacterized protein conserved in bacteria (DUF2225);  InterPro: IPR018708 This conserved bacterial family has no known function.
Probab=34.33  E-value=23  Score=40.47  Aligned_cols=42  Identities=17%  Similarity=0.060  Sum_probs=25.2

Q ss_pred             CCCcccCCCCcccCCchhhhccccc---c-------cCCCC-----ccCCCCCCcCC
Q 000417         1016 SRPHKKGIRFYAYKLKSGRLSRPRF---K-------KGLGA-----VSYRIRNRGAA 1057 (1534)
Q Consensus      1016 eKpYkC~iC~K~F~sks~L~rH~r~---H-------~gekp-----y~C~iCgksFs 1057 (1534)
                      .+.+.||+|++.|.++.-+....|.   .       .+..|     ..|+.||.+|.
T Consensus         3 ~k~~~CPvC~~~F~~~~vrs~~~r~~~~d~D~~~~Y~~vnP~~Y~V~vCP~CgyA~~   59 (214)
T PF09986_consen    3 DKKITCPVCGKEFKTKKVRSGKIRVIRRDSDFCPRYKGVNPLFYEVWVCPHCGYAAF   59 (214)
T ss_pred             CCceECCCCCCeeeeeEEEcCCceEeeecCCCccccCCCCCeeeeEEECCCCCCccc
Confidence            3556677777777766555554432   1       12233     47999998875


No 108
>PF13891 zf-C3Hc3H:  Potential DNA-binding domain
Probab=33.76  E-value=14  Score=34.46  Aligned_cols=24  Identities=38%  Similarity=0.663  Sum_probs=21.0

Q ss_pred             eecCCcccccccCCCcccccCCCC
Q 000417          587 TVLGTRCKHRALYGSSFCKKHRPR  610 (1534)
Q Consensus       587 ~~~~~~c~~~~~~~~~~c~k~~~~  610 (1534)
                      +..|+.|+.+++||+.||-+|-..
T Consensus         3 ~~~~~~C~~~~lp~~~yC~~HIl~   26 (65)
T PF13891_consen    3 TYSGRGCSQPALPGSKYCIRHILE   26 (65)
T ss_pred             CCCCCCcCcccCchhhHHHHHhcc
Confidence            567899999999999999999743


No 109
>smart00531 TFIIE Transcription initiation factor IIE.
Probab=33.20  E-value=31  Score=37.03  Aligned_cols=39  Identities=13%  Similarity=0.059  Sum_probs=23.5

Q ss_pred             CCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCccc
Q 000417          980 GSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAY 1028 (1534)
Q Consensus       980 tgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F 1028 (1534)
                      ....-|.|+.|+..|.....+..    .+.      ...|.|+.|+...
T Consensus        95 ~~~~~Y~Cp~C~~~y~~~ea~~~----~d~------~~~f~Cp~Cg~~l  133 (147)
T smart00531       95 TNNAYYKCPNCQSKYTFLEANQL----LDM------DGTFTCPRCGEEL  133 (147)
T ss_pred             cCCcEEECcCCCCEeeHHHHHHh----cCC------CCcEECCCCCCEE
Confidence            34456888888888876544422    011      2248888888654


No 110
>smart00391 MBD Methyl-CpG binding domain. Methyl-CpG binding domain, also known as the TAM (TTF-IIP5, ARBP, MeCP1) domain
Probab=32.20  E-value=16  Score=35.25  Aligned_cols=25  Identities=4%  Similarity=-0.181  Sum_probs=21.4

Q ss_pred             cccccCCCCcCCc-cccccceeeecc
Q 000417         1195 IRSSDSSDFVNNQ-WEVDECHCIIDS 1219 (1534)
Q Consensus      1195 ~k~v~~~~~~~~~-~~~~e~~~~l~~ 1219 (1534)
                      +..|.|..|+|.. +.+.|++.||..
T Consensus        27 ~~dV~Y~sP~GkklRs~~ev~~YL~~   52 (77)
T smart00391       27 KFDVYYISPCGKKLRSKSELARYLHK   52 (77)
T ss_pred             cccEEEECCCCCeeeCHHHHHHHHHh
Confidence            4568899999999 999999988764


No 111
>PF14353 CpXC:  CpXC protein
Probab=31.91  E-value=29  Score=36.16  Aligned_cols=49  Identities=20%  Similarity=0.247  Sum_probs=32.1

Q ss_pred             eecccCCccCC----------hhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccc
Q 000417          986 ICRFCGLKFDL----------LPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFK 1041 (1534)
Q Consensus       986 kC~~CgKsF~s----------ks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H 1041 (1534)
                      +|+.|+..|..          ...|+.   ++-.|.    --.|.|+.||+.|.-...+..|-..|
T Consensus         3 tCP~C~~~~~~~v~~~I~~~~~p~l~e---~il~g~----l~~~~CP~Cg~~~~~~~p~lY~D~~~   61 (128)
T PF14353_consen    3 TCPHCGHEFEFEVWTSINADEDPELKE---KILDGS----LFSFTCPSCGHKFRLEYPLLYHDPEK   61 (128)
T ss_pred             CCCCCCCeeEEEEEeEEcCcCCHHHHH---HHHcCC----cCEEECCCCCCceecCCCEEEEcCCC
Confidence            57777777653          233333   233342    34688999999999888888887555


No 112
>PF09986 DUF2225:  Uncharacterized protein conserved in bacteria (DUF2225);  InterPro: IPR018708 This conserved bacterial family has no known function.
Probab=31.68  E-value=14  Score=42.22  Aligned_cols=13  Identities=23%  Similarity=0.317  Sum_probs=10.2

Q ss_pred             cccccCCCccCCh
Q 000417          916 QQCIPCGSHFGNT  928 (1534)
Q Consensus       916 ykC~~CgK~Fssk  928 (1534)
                      ..|+.||.+|...
T Consensus        49 ~vCP~CgyA~~~~   61 (214)
T PF09986_consen   49 WVCPHCGYAAFEE   61 (214)
T ss_pred             EECCCCCCccccc
Confidence            3699999888754


No 113
>KOG2186 consensus Cell growth-regulating nucleolar protein [Cell cycle control, cell division, chromosome partitioning]
Probab=31.31  E-value=23  Score=41.04  Aligned_cols=44  Identities=27%  Similarity=0.616  Sum_probs=30.6

Q ss_pred             cccCccCcccCChHHHHhHhhhcccccccccccccccccCCCccCChHHHhhh
Q 000417          882 YACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNTEELWLH  934 (1534)
Q Consensus       882 ykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk~~Lk~H  934 (1534)
                      |.|..||.+.. +..+.+|+..-++.       -|.|-.|++.|.. ..+..|
T Consensus         4 FtCnvCgEsvK-Kp~vekH~srCrn~-------~fSCIDC~k~F~~-~sYknH   47 (276)
T KOG2186|consen    4 FTCNVCGESVK-KPQVEKHMSRCRNA-------YFSCIDCGKTFER-VSYKNH   47 (276)
T ss_pred             Eehhhhhhhcc-ccchHHHHHhccCC-------eeEEeeccccccc-chhhhh
Confidence            67888887665 44566687766663       3668888888877 566666


No 114
>PF09538 FYDLN_acid:  Protein of unknown function (FYDLN_acid);  InterPro: IPR012644 Members of this family are bacterial proteins with a conserved motif [KR]FYDLN, sometimes flanked by a pair of CXXC motifs, followed by a long region of low complexity sequence in which roughly half the residues are Asp and Glu, including multiple runs of five or more acidic residues. The function of members of this family is unknown.
Probab=30.37  E-value=33  Score=35.25  Aligned_cols=31  Identities=19%  Similarity=0.507  Sum_probs=19.7

Q ss_pred             cccCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCCh
Q 000417          847 THKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNK  894 (1534)
Q Consensus       847 pykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sk  894 (1534)
                      ...|+.||+.|....            .     .|..|+.||..|.-.
T Consensus         9 KR~Cp~CG~kFYDLn------------k-----~PivCP~CG~~~~~~   39 (108)
T PF09538_consen    9 KRTCPSCGAKFYDLN------------K-----DPIVCPKCGTEFPPE   39 (108)
T ss_pred             cccCCCCcchhccCC------------C-----CCccCCCCCCccCcc
Confidence            456777777776421            1     456677777777655


No 115
>PRK06266 transcription initiation factor E subunit alpha; Validated
Probab=29.71  E-value=31  Score=38.34  Aligned_cols=34  Identities=12%  Similarity=0.117  Sum_probs=21.7

Q ss_pred             CCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCccc
Q 000417          980 GSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAY 1028 (1534)
Q Consensus       980 tgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F 1028 (1534)
                      ....-|.|+.|++.|+...++.               ..|.|+.||...
T Consensus       113 ~~~~~Y~Cp~C~~rytf~eA~~---------------~~F~Cp~Cg~~L  146 (178)
T PRK06266        113 ENNMFFFCPNCHIRFTFDEAME---------------YGFRCPQCGEML  146 (178)
T ss_pred             cCCCEEECCCCCcEEeHHHHhh---------------cCCcCCCCCCCC
Confidence            3345677777777777666552               247777777543


No 116
>PF11722 zf-TRM13_CCCH:  CCCH zinc finger in TRM13 protein;  InterPro: IPR021721  This domain is found at the N terminus of TRM13 methyltransferase proteins. It is presumed to be a zinc binding domain. ; GO: 0008168 methyltransferase activity
Probab=29.41  E-value=30  Score=27.91  Aligned_cols=21  Identities=38%  Similarity=0.634  Sum_probs=18.4

Q ss_pred             cCCcccccccCCCcccccCCC
Q 000417          589 LGTRCKHRALYGSSFCKKHRP  609 (1534)
Q Consensus       589 ~~~~c~~~~~~~~~~c~k~~~  609 (1534)
                      -.+.|+-...+|+.||.-|.|
T Consensus        11 K~R~C~m~~~~g~~fC~~H~~   31 (31)
T PF11722_consen   11 KKRFCKMTRKPGSRFCGEHMP   31 (31)
T ss_pred             cccccCCeecCcCCccccCCC
Confidence            357899999999999999975


No 117
>KOG2461 consensus Transcription factor BLIMP-1/PRDI-BF1, contains C2H2-type Zn-finger and SET domains [Transcription]
Probab=27.65  E-value=73  Score=39.78  Aligned_cols=81  Identities=0%  Similarity=-0.295  Sum_probs=51.0

Q ss_pred             CchhhhhhhhhcCCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccccCCCCc
Q 000417          968 YSASVENHSENLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGLGAV 1047 (1534)
Q Consensus       968 k~~sLk~HlrtHtgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~gekpy 1047 (1534)
                      ..+....|...|++..+..++++.+.+.....+.. +...|.+     +.++.+..+...+.....+..+..+|+....+
T Consensus       315 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~~~-----~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~  388 (396)
T KOG2461|consen  315 KQLVLDQSEVPATVSVWTGETIPVRTPAGQLIYTQ-SHSMEVA-----EPTDMAPNQIWKIYHTGVLGFLIITTDESECN  388 (396)
T ss_pred             cccccccccccccccccCcCcccccccccccchhh-hhhcccC-----CCCcccccccccceeccccceeeeeccccccc
Confidence            33445666666777777777777777777777777 5566666     55566655555555555666666666666666


Q ss_pred             cCCCCCC
Q 000417         1048 SYRIRNR 1054 (1534)
Q Consensus      1048 ~C~iCgk 1054 (1534)
                      .+..|++
T Consensus       389 ~~~~~~~  395 (396)
T KOG2461|consen  389 NMSFVCK  395 (396)
T ss_pred             cccccCC
Confidence            6555543


No 118
>cd05839 BR140_related The PWWP domain is found in the BR140 family, which includes peregrin and BR140-like proteins 1 and 2.   BR140 is the only family to contain the PWWP domain at the C terminus, with PHD and bromo domains in the N-terminal region.  In myeloid leukemias, BR140 is disrupted by chromosomal translocations, similar to translocations of WHSC1 in lymphoid multiple myeloma.  The PWWP domain, named for a conserved Pro-Trp-Trp-Pro motif, is a small domain consisting of 100-150 amino acids. The PWWP domain is found in numerous proteins that are involved in cell division, growth and differentiation. Most PWWP-domain proteins seem to be nuclear, often DNA-binding proteins, that function as transcription factors regulating a variety of developmental processes.
Probab=27.36  E-value=92  Score=32.30  Aligned_cols=61  Identities=21%  Similarity=0.421  Sum_probs=40.7

Q ss_pred             EEEEEeccc-cccceeeeec----cC-----CCcccc----ccccCCCccEEEEEeccCCcchhhhhhccccccC
Q 000417          157 ALWVKWRGK-WQAGIRCARA----DW-----PLPTLK----AKPTHDRKKYFVIFFPHTRNYSWADMLLVRSINE  217 (1534)
Q Consensus       157 ~~~~~~~~~-~~~~~~~~~~----~~-----~~~~~~----~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~  217 (1534)
                      -||.|-+|- |.-|+-.-..    ..     |++-|+    .+.-.+.+.|+|-||=.+++|.|++---+.+..+
T Consensus         6 lVwaK~~g~P~wPa~iidp~~~~~~~~~~~~p~~~l~~~~~~~~~~~~~~~lV~FFd~~~s~~Wv~~~~l~pl~~   80 (111)
T cd05839           6 LVWAKCRGYPSYPALIIDPKMPRDGVFHNGVPPDVLTLGEARAQNADERLYLVLFFDNKRTWQWLPGDKLEPLGV   80 (111)
T ss_pred             EeeeeecCCCCCCeEeeCCCCCCcccccCCCCchhhhHHHHHhccCCCcEEEEEEecCCCcceecCHHHCccccc
Confidence            379998883 6666554422    11     112222    2334678889999999999999999887776654


No 119
>smart00834 CxxC_CXXC_SSSS Putative regulatory protein. CxxC_CXXC_SSSS represents a region of about 41 amino acids found in a number of small proteins in a wide range of bacteria. The region usually begins with the initiator Met and contains two CxxC motifs separated by 17 amino acids. One protein in this entry has been noted as a putative regulatory protein, designated FmdB. Most proteins in this entry have a C-terminal region containing highly degenerate sequence.
Probab=27.19  E-value=20  Score=29.63  Aligned_cols=11  Identities=36%  Similarity=1.093  Sum_probs=6.6

Q ss_pred             eeecccCCccC
Q 000417          985 FICRFCGLKFD  995 (1534)
Q Consensus       985 ykC~~CgKsF~  995 (1534)
                      |+|..||..|.
T Consensus         6 y~C~~Cg~~fe   16 (41)
T smart00834        6 YRCEDCGHTFE   16 (41)
T ss_pred             EEcCCCCCEEE
Confidence            56666666654


No 120
>PHA00626 hypothetical protein
Probab=26.81  E-value=22  Score=32.28  Aligned_cols=13  Identities=8%  Similarity=-0.455  Sum_probs=8.5

Q ss_pred             CcccCCCCcccCC
Q 000417         1018 PHKKGIRFYAYKL 1030 (1534)
Q Consensus      1018 pYkC~iC~K~F~s 1030 (1534)
                      .|+|+.|++.|+.
T Consensus        23 rYkCkdCGY~ft~   35 (59)
T PHA00626         23 DYVCCDCGYNDSK   35 (59)
T ss_pred             ceEcCCCCCeech
Confidence            5677777766654


No 121
>PF06524 NOA36:  NOA36 protein;  InterPro: IPR010531 This family consists of several NOA36 proteins which contain 29 highly conserved cysteine residues. The function of this protein is unknown.; GO: 0008270 zinc ion binding, 0005634 nucleus
Probab=25.82  E-value=40  Score=39.24  Aligned_cols=11  Identities=18%  Similarity=0.643  Sum_probs=6.6

Q ss_pred             CcccCCCCCcc
Q 000417          846 KTHKCKICSQV  856 (1534)
Q Consensus       846 kpykC~~CgK~  856 (1534)
                      +.-.|..|||.
T Consensus        62 rlp~Ca~Cgk~   72 (314)
T PF06524_consen   62 RLPMCAHCGKT   72 (314)
T ss_pred             cCchhhhcCCe
Confidence            44456777764


No 122
>TIGR02605 CxxC_CxxC_SSSS putative regulatory protein, FmdB family. This model represents a region of about 50 amino acids found in a number of small proteins in a wide range of bacteria. The region begins usually with the initiator Met and contains two CxxC motifs separated by 17 amino acids. One member of this family is has been noted as a putative regulatory protein, designated FmdB (PubMed:8841393). Most members of this family have a C-terminal region containing highly degenerate sequence, such as SSTSESTKSSGSSGSSGSSESKASGSTEKSTSSTTAAAAV in Mycobacterium tuberculosis and VAVGGSAPAPSPAPRAGGGGGGCCGGGCCG in Streptomyces avermitilis. These low complexity regions, which are not included in the model, resemble low-complexity C-terminal regions of some heterocycle-containing bacteriocin precursors.
Probab=25.37  E-value=24  Score=30.89  Aligned_cols=11  Identities=36%  Similarity=1.219  Sum_probs=5.9

Q ss_pred             eeecccCCccC
Q 000417          985 FICRFCGLKFD  995 (1534)
Q Consensus       985 ykC~~CgKsF~  995 (1534)
                      |+|..||..|.
T Consensus         6 y~C~~Cg~~fe   16 (52)
T TIGR02605         6 YRCTACGHRFE   16 (52)
T ss_pred             EEeCCCCCEeE
Confidence            55555555554


No 123
>PF09723 Zn-ribbon_8:  Zinc ribbon domain;  InterPro: IPR013429  This entry represents a region of about 41 amino acids found in a number of small proteins in a wide range of bacteria. The region usually begins with the initiator Met and contains two CxxC motifs separated by 17 amino acids. One protein in this entry has been noted as a putative regulatory protein, designated FmdB []. Most proteins in this entry have a C-terminal region containing highly degenerate sequence.
Probab=25.32  E-value=21  Score=30.36  Aligned_cols=12  Identities=33%  Similarity=1.099  Sum_probs=6.9

Q ss_pred             eeecccCCccCC
Q 000417          985 FICRFCGLKFDL  996 (1534)
Q Consensus       985 ykC~~CgKsF~s  996 (1534)
                      |+|..||..|..
T Consensus         6 y~C~~Cg~~fe~   17 (42)
T PF09723_consen    6 YRCEECGHEFEV   17 (42)
T ss_pred             EEeCCCCCEEEE
Confidence            556666666543


No 124
>PRK00464 nrdR transcriptional regulator NrdR; Validated
Probab=25.31  E-value=26  Score=38.12  Aligned_cols=40  Identities=15%  Similarity=0.080  Sum_probs=0.0

Q ss_pred             eeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCC
Q 000417          985 FICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKL 1030 (1534)
Q Consensus       985 ykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~s 1030 (1534)
                      ++||+||-.+..-.+=.-      ..+.....+.|+|+.||++|.+
T Consensus         1 m~cp~c~~~~~~~~~s~~------~~~~~~~~~~~~c~~c~~~f~~   40 (154)
T PRK00464          1 MRCPFCGHPDTRVIDSRP------AEDGNAIRRRRECLACGKRFTT   40 (154)
T ss_pred             CcCCCCCCCCCEeEeccc------cCCCCceeeeeeccccCCcceE


No 125
>PF12013 DUF3505:  Protein of unknown function (DUF3505);  InterPro: IPR022698  This family of proteins is functionally uncharacterised. This protein is found in eukaryotes. Proteins in this family are typically between 247 to 1018 amino acids in length. This region contains two segments that are likely to be C2H2 zinc binding domains. 
Probab=25.25  E-value=61  Score=32.87  Aligned_cols=24  Identities=21%  Similarity=0.400  Sum_probs=21.3

Q ss_pred             ccc----ccCCCccCChHHHhhhhhccc
Q 000417          916 QQC----IPCGSHFGNTEELWLHVQSVH  939 (1534)
Q Consensus       916 ykC----~~CgK~Fssk~~Lk~H~~rvH  939 (1534)
                      |.|    ..|+..+.+...+.+|++..|
T Consensus        81 ~~C~~~~~~C~y~~~~~~~m~~H~~~~H  108 (109)
T PF12013_consen   81 YRCQCDPPHCGYITRSKKTMRKHWRKEH  108 (109)
T ss_pred             eeeecCCCCCCcEeccHHHHHHHHHHhc
Confidence            789    999999999999999977666


No 126
>TIGR02300 FYDLN_acid conserved hypothetical protein TIGR02300. Members of this family are bacterial proteins with a conserved motif [KR]FYDLN, sometimes flanked by a pair of CXXC motifs, followed by a long region of low complexity sequence in which roughly half the residues are Asp and Glu, including multiple runs of five or more acidic residues. The function of members of this family is unknown.
Probab=24.80  E-value=43  Score=35.32  Aligned_cols=30  Identities=27%  Similarity=0.253  Sum_probs=18.4

Q ss_pred             eeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCc
Q 000417          985 FICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLK 1031 (1534)
Q Consensus       985 ykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sk 1031 (1534)
                      ..|+.||++|.-   |.              ..|-.|++||..|.-.
T Consensus        10 r~Cp~cg~kFYD---Ln--------------k~p~vcP~cg~~~~~~   39 (129)
T TIGR02300        10 RICPNTGSKFYD---LN--------------RRPAVSPYTGEQFPPE   39 (129)
T ss_pred             ccCCCcCccccc---cC--------------CCCccCCCcCCccCcc
Confidence            467777777753   21              2466777777766554


No 127
>PF08879 WRC:  WRC;  InterPro: IPR014977 WRC is named after the conserved Trp-Arg-Cys motif, it contains two distinctive features: a putative nuclear localisation signal and a zinc-finger motif (C3H). It is suggested that WRC functions in DNA binding []. ; GO: 0005515 protein binding
Probab=24.77  E-value=26  Score=30.78  Aligned_cols=20  Identities=50%  Similarity=0.865  Sum_probs=18.2

Q ss_pred             cCCcccccccCCCcccccCC
Q 000417          589 LGTRCKHRALYGSSFCKKHR  608 (1534)
Q Consensus       589 ~~~~c~~~~~~~~~~c~k~~  608 (1534)
                      -|=||+.++++|.++|.+|.
T Consensus        13 K~WrC~~~a~~g~~~Ce~H~   32 (46)
T PF08879_consen   13 KGWRCSRRALPGYSLCEHHL   32 (46)
T ss_pred             CccccCCccCCCccHHHHHH
Confidence            46699999999999999997


No 128
>COG1997 RPL43A Ribosomal protein L37AE/L43A [Translation, ribosomal structure and biogenesis]
Probab=24.06  E-value=31  Score=34.09  Aligned_cols=32  Identities=22%  Similarity=0.257  Sum_probs=18.8

Q ss_pred             ceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCC
Q 000417          983 RKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKL 1030 (1534)
Q Consensus       983 KpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~s 1030 (1534)
                      .+|.|+.|++.-         +.|+-+|       -+.|..|++.|.-
T Consensus        34 ~~~~Cp~C~~~~---------VkR~a~G-------IW~C~kCg~~fAG   65 (89)
T COG1997          34 AKHVCPFCGRTT---------VKRIATG-------IWKCRKCGAKFAG   65 (89)
T ss_pred             cCCcCCCCCCcc---------eeeeccC-------eEEcCCCCCeecc
Confidence            356777776651         3344444       5677777776654


No 129
>PF02892 zf-BED:  BED zinc finger;  InterPro: IPR003656 Zinc finger (Znf) domains are relatively small protein motifs which contain multiple finger-like protrusions that make tandem contacts with their target molecule. Some of these domains bind zinc, but many do not; instead binding other metals such as iron, or no metal at all. For example, some family members form salt bridges to stabilise the finger-like folds. They were first identified as a DNA-binding motif in transcription factor TFIIIA from Xenopus laevis (African clawed frog), however they are now recognised to bind DNA, RNA, protein and/or lipid substrates [, , , , ]. Their binding properties depend on the amino acid sequence of the finger domains and of the linker between fingers, as well as on the higher-order structures and the number of fingers. Znf domains are often found in clusters, where fingers can have different binding specificities. There are many superfamilies of Znf motifs, varying in both sequence and structure. They display considerable versatility in binding modes, even between members of the same class (e.g. some bind DNA, others protein), suggesting that Znf motifs are stable scaffolds that have evolved specialised functions. For example, Znf-containing proteins function in gene transcription, translation, mRNA trafficking, cytoskeleton organisation, epithelial development, cell adhesion, protein folding, chromatin remodelling and zinc sensing, to name but a few []. Zinc-binding motifs are stable structures, and they rarely undergo conformational changes upon binding their target.  This entry represents predicted BED-type zinc finger domains. The BED finger which was named after the Drosophila proteins BEAF and DREF, is found in one or more copies in cellular regulatory factors and transposases from plants, animals and fungi. The BED finger is an about 50 to 60 amino acid residues domain that contains a characteristic motif with two highly conserved aromatic positions, as well as a shared pattern of cysteines and histidines that is predicted to form a zinc finger. As diverse BED fingers are able to bind DNA, it has been suggested that DNA-binding is the general function of this domain []. Some proteins known to contain a BED domain include animal, plant and fungi AC1 and Hobo-like transposases; Caenorhabditis elegans Dpy-20 protein, a predicted cuticular gene transcriptional regulator; Drosophila BEAF (boundary element-associated factor), thought to be involved in chromatin insulation; Drosophila DREF, a transcriptional regulator for S-phase genes; and tobacco 3AF1 and tomato E4/E8-BP1, light- and ethylene-regulated DNA binding proteins that contain two BED fingers. More information about these proteins can be found at Protein of the Month: Zinc Fingers [].; GO: 0003677 DNA binding; PDB: 2DJR_A 2CT5_A.
Probab=24.02  E-value=58  Score=27.55  Aligned_cols=28  Identities=29%  Similarity=0.642  Sum_probs=15.7

Q ss_pred             CcceeeecccCCccCCh----hHHHHHHHhhc
Q 000417          981 SIRKFICRFCGLKFDLL----PDLGRHHQAAH 1008 (1534)
Q Consensus       981 geKpykC~~CgKsF~sk----s~LkrHH~rtH 1008 (1534)
                      +....+|.+|++.+...    +.|.+|..+.|
T Consensus        13 ~~~~a~C~~C~~~~~~~~~~ts~l~~HL~~~h   44 (45)
T PF02892_consen   13 DKKKAKCKYCGKVIKYSSGGTSNLKRHLKKKH   44 (45)
T ss_dssp             CSS-EEETTTTEE-----SSTHHHHHHHHHTT
T ss_pred             CcCeEEeCCCCeEEeeCCCcHHHHHHhhhhhC
Confidence            34567788888887764    67777544555


No 130
>COG1198 PriA Primosomal protein N' (replication factor Y) - superfamily II helicase [DNA replication, recombination, and repair]
Probab=24.01  E-value=51  Score=44.07  Aligned_cols=25  Identities=8%  Similarity=-0.202  Sum_probs=17.5

Q ss_pred             CCCcccCCCCcccCCchhhhcccccccCCCCccCCCCCCc
Q 000417         1016 SRPHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRIRNRG 1055 (1534)
Q Consensus      1016 eKpYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~iCgks 1055 (1534)
                      .+...|.+||+               +...|..|+.||-.
T Consensus       460 ~~~L~CH~Cg~---------------~~~~p~~Cp~Cgs~  484 (730)
T COG1198         460 TGQLRCHYCGY---------------QEPIPQSCPECGSE  484 (730)
T ss_pred             CCeeEeCCCCC---------------CCCCCCCCCCCCCC
Confidence            45677888874               34567888888864


No 131
>TIGR00622 ssl1 transcription factor ssl1. This family is based on the phylogenomic analysis of JA Eisen (1999, Ph.D. Thesis, Stanford University).
Probab=23.57  E-value=57  Score=33.84  Aligned_cols=24  Identities=0%  Similarity=-0.060  Sum_probs=12.1

Q ss_pred             CcccCCCCcccCCchhhhcccccc
Q 000417         1018 PHKKGIRFYAYKLKSGRLSRPRFK 1041 (1534)
Q Consensus      1018 pYkC~iC~K~F~sks~L~rH~r~H 1041 (1534)
                      .|+|+.|...|-..-+.-.|...|
T Consensus        81 ~y~C~~C~~~FC~dCD~fiHe~Lh  104 (112)
T TIGR00622        81 RYVCAVCKNVFCVDCDVFVHESLH  104 (112)
T ss_pred             ceeCCCCCCccccccchhhhhhcc
Confidence            455555555555555555554444


No 132
>COG1996 RPC10 DNA-directed RNA polymerase, subunit RPC10 (contains C4-type Zn-finger) [Transcription]
Probab=23.43  E-value=41  Score=29.95  Aligned_cols=29  Identities=14%  Similarity=0.135  Sum_probs=19.2

Q ss_pred             ceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcc
Q 000417          983 RKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYA 1027 (1534)
Q Consensus       983 KpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~ 1027 (1534)
                      ..|+|-.||+.|.   .+..             .....|+.||..
T Consensus         5 ~~Y~C~~Cg~~~~---~~~~-------------~~~irCp~Cg~r   33 (49)
T COG1996           5 MEYKCARCGREVE---LDQE-------------TRGIRCPYCGSR   33 (49)
T ss_pred             EEEEhhhcCCeee---hhhc-------------cCceeCCCCCcE
Confidence            4688888888881   1222             456788888854


No 133
>PRK14890 putative Zn-ribbon RNA-binding protein; Provisional
Probab=22.86  E-value=53  Score=30.33  Aligned_cols=32  Identities=22%  Similarity=0.285  Sum_probs=19.8

Q ss_pred             ceeeecccCCc-cCChhHHHHHHHhhccCCCCCCCCCcccCCCCc
Q 000417          983 RKFICRFCGLK-FDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFY 1026 (1534)
Q Consensus       983 KpykC~~CgKs-F~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K 1026 (1534)
                      -.|.|+.||+. -.+-..-++     +       ..+|.|+.||.
T Consensus        24 ~~F~CPnCG~~~I~RC~~CRk-----~-------~~~Y~CP~CGF   56 (59)
T PRK14890         24 VKFLCPNCGEVIIYRCEKCRK-----Q-------SNPYTCPKCGF   56 (59)
T ss_pred             CEeeCCCCCCeeEeechhHHh-----c-------CCceECCCCCC
Confidence            46888888877 333322222     2       45888888875


No 134
>PF08666 SAF:  SAF domain;  InterPro: IPR013974  This entry includes a range of different proteins, such as antifreeze proteins, flagellar FlgA proteins, and CpaB pilus proteins. ; PDB: 1C89_A 3NLA_A 3RDN_A 1C8A_A 3FRN_A 1WVO_A 3K3S_H 3G8R_B 1XUU_A 1XUZ_A ....
Probab=21.73  E-value=53  Score=29.42  Aligned_cols=15  Identities=40%  Similarity=0.547  Sum_probs=11.4

Q ss_pred             EEEEccCCCCCCeEE
Q 000417         1493 GLYASRDIAVGEELT 1507 (1534)
Q Consensus      1493 afFA~RDI~aGEELT 1507 (1534)
                      .++|.|||++|+.|+
T Consensus         3 vvVA~~di~~G~~i~   17 (63)
T PF08666_consen    3 VVVAARDIPAGTVIT   17 (63)
T ss_dssp             EEEESSTB-TT-BEC
T ss_pred             EEEEeCccCCCCEEc
Confidence            478999999999995


No 135
>PF14353 CpXC:  CpXC protein
Probab=21.30  E-value=34  Score=35.60  Aligned_cols=20  Identities=40%  Similarity=0.541  Sum_probs=15.9

Q ss_pred             ceeeecccCCccCChhHHHH
Q 000417          983 RKFICRFCGLKFDLLPDLGR 1002 (1534)
Q Consensus       983 KpykC~~CgKsF~sks~Lkr 1002 (1534)
                      -.|.|+.||..|.-...+.-
T Consensus        37 ~~~~CP~Cg~~~~~~~p~lY   56 (128)
T PF14353_consen   37 FSFTCPSCGHKFRLEYPLLY   56 (128)
T ss_pred             CEEECCCCCCceecCCCEEE
Confidence            46999999999987666655


No 136
>COG2888 Predicted Zn-ribbon RNA-binding protein with a function in translation [Translation, ribosomal structure and biogenesis]
Probab=21.16  E-value=61  Score=29.97  Aligned_cols=33  Identities=18%  Similarity=0.067  Sum_probs=21.5

Q ss_pred             ceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCc
Q 000417          983 RKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFY 1026 (1534)
Q Consensus       983 KpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K 1026 (1534)
                      -.|.|+.||..-..+..--    |.|       ..+|.|+.||.
T Consensus        26 v~F~CPnCGe~~I~Rc~~C----Rk~-------g~~Y~Cp~CGF   58 (61)
T COG2888          26 VKFPCPNCGEVEIYRCAKC----RKL-------GNPYRCPKCGF   58 (61)
T ss_pred             eEeeCCCCCceeeehhhhH----HHc-------CCceECCCcCc
Confidence            4688999996655544322    233       34899999985


No 137
>cd05834 HDGF_related The PWWP domain is an essential part of the Hepatoma Derived Growth Factor (HDGF) family of proteins, and is necessary for DNA binding by HDGF. This family of endogenous nuclear-targeted mitogens includes HRP (HDGF-related proteins 1, 2, 3, 4, or HPR1, HPR2, HPR3, HPR4, respectively) and lens epithelium-derived growth factor, LEDGF. Members of the HDGF family have been linked to human diseases, and HDGF is a prognostic factor in several types of cancer. The PWWP domain, named for a conserved Pro-Trp-Trp-Pro motif, is a small domain consisting of 100-150 amino acids. The PWWP domain is found in numerous proteins that are involved in cell division, growth and differentiation. Most PWWP-domain proteins seem to be nuclear, often DNA-binding, proteins that function as transcription factors regulating a variety of developmental processes.
Probab=21.07  E-value=1.2e+02  Score=29.69  Aligned_cols=52  Identities=23%  Similarity=0.233  Sum_probs=35.5

Q ss_pred             EEEEEeccc-cccceeeeeccCCCccccccccCCCccEEEEEeccCCcchhhhhhccccccCC
Q 000417          157 ALWVKWRGK-WQAGIRCARADWPLPTLKAKPTHDRKKYFVIFFPHTRNYSWADMLLVRSINEF  218 (1534)
Q Consensus       157 ~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~  218 (1534)
                      -+|.|=+|- |=-|+=|...+.         +-..++|.|.||. |..|.||..-.+.++.++
T Consensus         8 lVwaK~kGyp~WPa~I~~~~~~---------~~~~~~~~V~FfG-t~~~a~v~~~~l~pf~~~   60 (83)
T cd05834           8 LVFAKVKGYPAWPARVDEPEDW---------KPPGKKYPVYFFG-THETAFLKPEDLFPYTEN   60 (83)
T ss_pred             EEEEecCCCCCCCEEEeccccc---------CCCCCEEEEEEeC-CCCEeEECHHHceecccc
Confidence            368887773 333444444332         2235789999999 789999998888888775


No 138
>KOG1280 consensus Uncharacterized conserved protein containing ZZ-type Zn-finger [General function prediction only]
Probab=20.82  E-value=57  Score=39.48  Aligned_cols=29  Identities=24%  Similarity=0.476  Sum_probs=23.1

Q ss_pred             cceeeecccCCccCChhHHHHHHHhhccC
Q 000417          982 IRKFICRFCGLKFDLLPDLGRHHQAAHMG 1010 (1534)
Q Consensus       982 eKpykC~~CgKsF~sks~LkrHH~rtHtg 1010 (1534)
                      ...|.|++|++.=.+...|..|....|..
T Consensus        77 ~qSftCPyC~~~Gfte~~f~~Hv~s~Hpd  105 (381)
T KOG1280|consen   77 PQSFTCPYCGIMGFTERQFGTHVLSQHPE  105 (381)
T ss_pred             cccccCCcccccccchhHHHHHhhhcCcc
Confidence            35688888888888888888877788866


No 139
>PF13717 zinc_ribbon_4:  zinc-ribbon domain
Probab=20.53  E-value=66  Score=26.64  Aligned_cols=14  Identities=21%  Similarity=0.667  Sum_probs=7.2

Q ss_pred             eecccCCccCChhH
Q 000417          986 ICRFCGLKFDLLPD  999 (1534)
Q Consensus       986 kC~~CgKsF~sks~  999 (1534)
                      .|+.|+..|.-...
T Consensus         4 ~Cp~C~~~y~i~d~   17 (36)
T PF13717_consen    4 TCPNCQAKYEIDDE   17 (36)
T ss_pred             ECCCCCCEEeCCHH
Confidence            45555555554443


No 140
>KOG2593 consensus Transcription initiation factor IIE, alpha subunit [Transcription]
Probab=20.44  E-value=58  Score=40.61  Aligned_cols=47  Identities=13%  Similarity=0.152  Sum_probs=30.2

Q ss_pred             hhhhhhhcCCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcc
Q 000417          972 VENHSENLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYA 1027 (1534)
Q Consensus       972 Lk~HlrtHtgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~ 1027 (1534)
                      |+.-++.-+....|.|+.|.++|.....|.-  +..-       ...|.|..|+-.
T Consensus       116 led~~~d~t~~~~Y~Cp~C~kkyt~Lea~~L--~~~~-------~~~F~C~~C~ge  162 (436)
T KOG2593|consen  116 LEDRLRDDTNVAGYVCPNCQKKYTSLEALQL--LDNE-------TGEFHCENCGGE  162 (436)
T ss_pred             HHHHhhhccccccccCCccccchhhhHHHHh--hccc-------CceEEEecCCCc
Confidence            3444445555677999999999888777654  1111       236888888743


No 141
>smart00531 TFIIE Transcription initiation factor IIE.
Probab=20.36  E-value=58  Score=34.97  Aligned_cols=39  Identities=15%  Similarity=0.173  Sum_probs=26.6

Q ss_pred             CCCCCccccCCCchhhhhhhhhcCCcceeeecccCCccC
Q 000417          957 GEDSPKKLELGYSASVENHSENLGSIRKFICRFCGLKFD  995 (1534)
Q Consensus       957 geKp~~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKsF~  995 (1534)
                      ...-|.|+.|+..+....-+........|.|+.||....
T Consensus        96 ~~~~Y~Cp~C~~~y~~~ea~~~~d~~~~f~Cp~Cg~~l~  134 (147)
T smart00531       96 NNAYYKCPNCQSKYTFLEANQLLDMDGTFTCPRCGEELE  134 (147)
T ss_pred             CCcEEECcCCCCEeeHHHHHHhcCCCCcEECCCCCCEEE
Confidence            455688999998877655544321245599999998753


Done!