Query 000417
Match_columns 1534
No_of_seqs 908 out of 5486
Neff 5.5
Searched_HMMs 46136
Date Fri Mar 29 07:53:45 2013
Command hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/000417.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/000417hhsearch_cdd -cpu 12 -v 0
No Hit Prob E-value P-value Score SS Cols Query HMM Template HMM
1 KOG1082 Histone H3 (Lys9) meth 100.0 9.9E-43 2.1E-47 412.9 17.1 274 1225-1534 53-354 (364)
2 KOG4442 Clathrin coat binding 100.0 2.3E-38 5E-43 379.6 12.7 163 1354-1533 93-259 (729)
3 KOG1141 Predicted histone meth 100.0 7.9E-39 1.7E-43 381.2 6.5 199 1197-1419 620-839 (1262)
4 KOG1080 Histone H3 (Lys4) meth 99.9 2E-27 4.4E-32 303.1 10.6 137 1379-1533 866-1004(1005)
5 KOG1079 Transcriptional repres 99.9 1.7E-26 3.7E-31 276.1 10.1 132 1367-1515 582-713 (739)
6 KOG2462 C2H2-type Zn-finger pr 99.9 6.8E-23 1.5E-27 226.9 3.2 137 880-1068 129-265 (279)
7 smart00317 SET SET (Su(var)3-9 99.8 3.9E-21 8.5E-26 189.6 12.3 114 1380-1510 1-116 (116)
8 KOG2462 C2H2-type Zn-finger pr 99.8 1E-21 2.2E-26 217.6 5.5 141 842-1040 125-265 (279)
9 KOG1083 Putative transcription 99.8 2.8E-21 6.1E-26 238.4 2.0 131 1367-1514 1165-1297(1306)
10 KOG3608 Zn finger proteins [Ge 99.7 5E-19 1.1E-23 199.0 1.9 189 847-1067 177-373 (467)
11 KOG1074 Transcriptional repres 99.7 9.6E-18 2.1E-22 205.0 5.7 218 845-1071 603-932 (958)
12 KOG1085 Predicted methyltransf 99.7 4.2E-17 9.1E-22 179.6 8.8 128 1373-1514 250-380 (392)
13 KOG3608 Zn finger proteins [Ge 99.7 1.5E-17 3.2E-22 187.3 3.5 192 836-1059 196-399 (467)
14 PF05033 Pre-SET: Pre-SET moti 99.7 1.3E-16 2.7E-21 157.8 7.7 102 1236-1371 1-103 (103)
15 KOG3623 Homeobox transcription 99.7 2.2E-17 4.7E-22 198.3 2.6 80 984-1070 894-973 (1007)
16 KOG1074 Transcriptional repres 99.7 4.2E-17 9.2E-22 199.5 5.1 240 846-1101 352-719 (958)
17 smart00468 PreSET N-terminal t 99.6 1.4E-15 3.1E-20 149.3 8.3 96 1234-1363 1-98 (98)
18 COG2940 Proteins containing SE 99.6 1E-15 2.2E-20 189.0 2.5 164 1355-1533 308-479 (480)
19 KOG3576 Ovo and related transc 99.3 3.2E-13 7E-18 143.5 0.5 85 844-940 114-198 (267)
20 PF00856 SET: SET domain; Int 99.3 1.8E-12 3.8E-17 133.6 4.7 118 1390-1511 1-162 (162)
21 KOG3576 Ovo and related transc 99.3 1.7E-12 3.8E-17 138.0 4.1 121 880-1047 116-241 (267)
22 KOG3623 Homeobox transcription 99.2 5.4E-12 1.2E-16 152.7 1.8 125 882-1044 211-335 (1007)
23 PLN03086 PRLI-interacting fact 98.8 6.3E-09 1.4E-13 128.7 6.0 139 882-1067 408-561 (567)
24 KOG1081 Transcription factor N 98.7 4.5E-09 9.7E-14 129.0 1.9 145 1355-1533 289-436 (463)
25 PLN03086 PRLI-interacting fact 98.7 1.3E-08 2.7E-13 126.1 5.3 143 846-1038 406-560 (567)
26 PHA00733 hypothetical protein 98.6 1.5E-08 3.3E-13 104.6 3.5 87 914-1044 39-125 (128)
27 KOG2589 Histone tail methylase 98.6 1.8E-08 3.9E-13 115.8 4.3 117 1387-1526 135-252 (453)
28 KOG1141 Predicted histone meth 98.5 1.5E-07 3.3E-12 116.0 6.0 286 1228-1534 871-1262(1262)
29 PHA00733 hypothetical protein 98.3 3.1E-07 6.8E-12 95.0 2.9 81 981-1068 37-121 (128)
30 KOG3993 Transcription factor ( 98.3 2.3E-07 4.9E-12 108.6 1.5 187 843-1042 263-483 (500)
31 PHA02768 hypothetical protein; 98.1 6.5E-07 1.4E-11 78.8 0.0 42 985-1034 6-47 (55)
32 PHA02768 hypothetical protein; 98.1 2E-06 4.4E-11 75.8 2.4 45 1018-1064 5-49 (55)
33 KOG3993 Transcription factor ( 98.0 2.1E-06 4.5E-11 100.8 2.6 171 881-1068 267-480 (500)
34 KOG2461 Transcription factor B 97.8 2.3E-05 4.9E-10 94.9 5.8 114 1377-1515 26-147 (396)
35 PF13465 zf-H2C2_2: Zinc-finge 97.6 2.9E-05 6.2E-10 58.8 1.4 24 972-995 2-25 (26)
36 PHA00732 hypothetical protein 97.4 0.00012 2.6E-09 69.9 3.1 48 984-1043 1-49 (79)
37 PF13465 zf-H2C2_2: Zinc-finge 97.3 0.00013 2.8E-09 55.3 2.1 25 999-1029 1-25 (26)
38 PHA00616 hypothetical protein 97.2 6.6E-05 1.4E-09 63.5 -0.4 26 984-1010 1-26 (44)
39 PHA00732 hypothetical protein 97.1 0.00026 5.7E-09 67.6 2.2 46 1018-1069 1-47 (79)
40 PF05605 zf-Di19: Drought indu 97.1 0.00035 7.6E-09 61.9 2.7 53 984-1043 2-54 (54)
41 PHA00616 hypothetical protein 96.9 0.00029 6.4E-09 59.7 0.9 34 1018-1051 1-34 (44)
42 PF05605 zf-Di19: Drought indu 96.9 0.00084 1.8E-08 59.5 3.4 52 847-905 2-53 (54)
43 COG5189 SFP1 Putative transcri 96.7 0.00084 1.8E-08 76.9 2.7 57 982-1038 347-418 (423)
44 PF12756 zf-C2H2_2: C2H2 type 95.7 0.0057 1.2E-07 59.4 2.2 72 917-1007 1-72 (100)
45 PF00096 zf-C2H2: Zinc finger, 95.6 0.006 1.3E-07 44.4 1.5 23 985-1008 1-23 (23)
46 PF00096 zf-C2H2: Zinc finger, 95.6 0.0029 6.2E-08 46.1 -0.2 23 1019-1041 1-23 (23)
47 COG5189 SFP1 Putative transcri 95.6 0.0042 9.2E-08 71.4 1.0 67 845-934 347-417 (423)
48 PF12756 zf-C2H2_2: C2H2 type 95.6 0.0053 1.1E-07 59.6 1.5 73 849-938 1-73 (100)
49 KOG1146 Homeobox protein [Gene 95.3 0.0064 1.4E-07 80.9 1.3 177 849-1041 438-641 (1406)
50 PF13894 zf-C2H2_4: C2H2-type 94.6 0.0092 2E-07 43.1 0.0 18 985-1002 1-18 (24)
51 PF13912 zf-C2H2_6: C2H2-type 94.5 0.015 3.2E-07 44.0 0.8 23 1019-1041 2-24 (27)
52 PF13894 zf-C2H2_4: C2H2-type 94.4 0.025 5.4E-07 40.8 1.8 22 883-904 2-23 (24)
53 KOG2231 Predicted E3 ubiquitin 93.9 0.063 1.4E-06 68.7 5.3 11 848-858 100-110 (669)
54 PF13912 zf-C2H2_6: C2H2-type 93.9 0.034 7.4E-07 42.0 1.8 26 984-1010 1-26 (27)
55 PF09237 GAGA: GAGA factor; I 93.3 0.028 6E-07 49.1 0.4 31 1016-1046 22-52 (54)
56 smart00508 PostSET Cysteine-ri 93.0 0.047 1E-06 41.6 1.2 15 1519-1533 2-16 (26)
57 KOG2231 Predicted E3 ubiquitin 93.0 0.087 1.9E-06 67.5 4.3 109 918-1044 118-238 (669)
58 KOG1146 Homeobox protein [Gene 92.5 0.066 1.4E-06 71.8 2.3 158 884-1068 439-640 (1406)
59 cd01395 HMT_MBD Methyl-CpG bin 91.1 0.048 1E-06 49.7 -0.8 36 1184-1219 1-48 (60)
60 smart00355 ZnF_C2H2 zinc finge 90.6 0.17 3.6E-06 36.8 1.8 24 985-1009 1-24 (26)
61 COG5048 FOG: Zn-finger [Genera 90.5 0.19 4.1E-06 60.3 3.3 62 990-1055 394-455 (467)
62 PRK04860 hypothetical protein; 90.5 0.098 2.1E-06 56.7 0.8 39 983-1031 118-156 (160)
63 PRK04860 hypothetical protein; 90.4 0.16 3.5E-06 55.0 2.3 36 1018-1057 119-154 (160)
64 COG5236 Uncharacterized conser 90.2 0.17 3.8E-06 59.1 2.5 84 847-940 151-245 (493)
65 cd05162 PWWP The PWWP domain, 89.7 0.31 6.8E-06 47.2 3.4 60 157-220 6-66 (87)
66 smart00355 ZnF_C2H2 zinc finge 89.4 0.27 5.8E-06 35.7 2.1 20 883-902 2-21 (26)
67 PF09237 GAGA: GAGA factor; I 88.5 0.29 6.2E-06 43.1 1.9 29 880-908 23-51 (54)
68 COG5048 FOG: Zn-finger [Genera 88.5 0.28 6E-06 58.8 2.6 139 915-1070 289-442 (467)
69 cd05840 SPBC215_ISWI_like The 88.1 0.37 7.9E-06 47.8 2.7 59 157-216 6-65 (93)
70 PF13909 zf-H2C2_5: C2H2-type 86.9 0.17 3.7E-06 37.3 -0.3 22 1019-1041 1-22 (24)
71 PF11722 zf-TRM13_CCCH: CCCH z 85.6 0.24 5.3E-06 39.4 -0.0 29 533-561 2-30 (31)
72 PF12874 zf-met: Zinc-finger o 85.3 0.26 5.6E-06 36.5 -0.0 19 1020-1038 2-20 (25)
73 PF12874 zf-met: Zinc-finger o 85.1 0.4 8.7E-06 35.5 0.9 20 883-902 2-21 (25)
74 PF13909 zf-H2C2_5: C2H2-type 83.9 0.63 1.4E-05 34.3 1.5 23 882-905 1-23 (24)
75 KOG4173 Alpha-SNAP protein [In 83.6 0.42 9.1E-06 52.8 0.6 91 880-1010 78-172 (253)
76 PF12171 zf-C2H2_jaz: Zinc-fin 83.6 0.64 1.4E-05 35.4 1.5 22 1019-1040 2-23 (27)
77 COG5236 Uncharacterized conser 83.4 0.62 1.3E-05 54.8 1.9 130 881-1067 151-302 (493)
78 smart00570 AWS associated with 82.1 0.54 1.2E-05 41.7 0.6 24 1353-1376 26-49 (51)
79 KOG4173 Alpha-SNAP protein [In 81.2 0.44 9.5E-06 52.7 -0.3 87 845-940 77-171 (253)
80 KOG2785 C2H2-type Zn-finger pr 80.4 2.4 5.2E-05 51.2 5.3 26 984-1010 166-191 (390)
81 KOG2482 Predicted C2H2-type Zn 79.6 3.1 6.7E-05 49.4 5.7 26 985-1010 280-305 (423)
82 KOG2084 Predicted histone tail 79.2 2.3 4.9E-05 52.8 4.9 53 1466-1526 208-271 (482)
83 PF12171 zf-C2H2_jaz: Zinc-fin 78.3 1.1 2.4E-05 34.1 1.2 21 882-902 2-22 (27)
84 KOG2482 Predicted C2H2-type Zn 75.1 2.8 6E-05 49.8 3.7 23 1018-1040 334-356 (423)
85 KOG2893 Zn finger protein [Gen 69.4 1.8 3.8E-05 48.9 0.5 48 883-940 12-59 (341)
86 cd05837 MSH6_like The PWWP dom 64.8 6.9 0.00015 40.0 3.7 63 157-219 8-71 (110)
87 COG4049 Uncharacterized protei 62.1 3.1 6.7E-05 37.3 0.5 35 839-873 9-43 (65)
88 KOG2785 C2H2-type Zn-finger pr 61.2 3.3 7.2E-05 50.1 0.7 172 881-1067 3-241 (390)
89 smart00451 ZnF_U1 U1-like zinc 57.9 6.2 0.00013 31.4 1.5 25 881-905 3-27 (35)
90 KOG2893 Zn finger protein [Gen 57.5 3.3 7.1E-05 46.9 -0.1 47 987-1043 13-60 (341)
91 KOG1337 N-methyltransferase [G 56.3 8 0.00017 49.0 3.0 40 1466-1512 239-278 (472)
92 PF13913 zf-C2HC_2: zinc-finge 55.1 9 0.0002 29.1 1.9 18 883-901 4-21 (25)
93 smart00451 ZnF_U1 U1-like zinc 54.5 4.6 0.0001 32.2 0.3 21 1018-1038 3-23 (35)
94 PF13913 zf-C2HC_2: zinc-finge 51.3 10 0.00022 28.9 1.6 17 985-1002 3-19 (25)
95 COG0068 HypF Hydrogenase matur 47.9 6.9 0.00015 50.9 0.5 13 943-955 102-114 (750)
96 COG4049 Uncharacterized protei 43.8 10 0.00023 34.2 0.8 33 978-1010 11-43 (65)
97 KOG3813 Uncharacterized conser 40.7 13 0.00027 46.6 1.1 19 1299-1318 307-325 (640)
98 PF12013 DUF3505: Protein of u 39.7 34 0.00074 34.7 3.9 27 1017-1043 79-109 (109)
99 smart00293 PWWP domain with co 39.6 32 0.00069 31.6 3.3 56 157-215 6-62 (63)
100 PF00855 PWWP: PWWP domain; I 38.3 31 0.00068 32.9 3.3 56 157-219 6-62 (86)
101 cd00350 rubredoxin_like Rubred 37.1 23 0.00049 28.6 1.7 10 1045-1054 16-25 (33)
102 COG1198 PriA Primosomal protei 36.8 17 0.00037 48.3 1.5 42 1112-1154 603-645 (730)
103 PF09538 FYDLN_acid: Protein o 36.2 18 0.0004 37.1 1.3 30 985-1031 10-39 (108)
104 TIGR02098 MJ0042_CXXC MJ0042 f 35.2 19 0.00041 29.6 1.0 34 985-1029 3-36 (38)
105 cd05838 WHSC1_related The PWWP 35.0 30 0.00065 34.6 2.6 54 158-214 7-61 (95)
106 TIGR00373 conserved hypothetic 34.5 26 0.00056 38.2 2.2 39 974-1027 99-137 (158)
107 PF09986 DUF2225: Uncharacteri 34.3 23 0.00049 40.5 1.8 42 1016-1057 3-59 (214)
108 PF13891 zf-C3Hc3H: Potential 33.8 14 0.0003 34.5 -0.0 24 587-610 3-26 (65)
109 smart00531 TFIIE Transcription 33.2 31 0.00067 37.0 2.5 39 980-1028 95-133 (147)
110 smart00391 MBD Methyl-CpG bind 32.2 16 0.00034 35.3 0.1 25 1195-1219 27-52 (77)
111 PF14353 CpXC: CpXC protein 31.9 29 0.00062 36.2 2.0 49 986-1041 3-61 (128)
112 PF09986 DUF2225: Uncharacteri 31.7 14 0.0003 42.2 -0.5 13 916-928 49-61 (214)
113 KOG2186 Cell growth-regulating 31.3 23 0.0005 41.0 1.2 44 882-934 4-47 (276)
114 PF09538 FYDLN_acid: Protein o 30.4 33 0.00072 35.3 2.1 31 847-894 9-39 (108)
115 PRK06266 transcription initiat 29.7 31 0.00068 38.3 1.9 34 980-1028 113-146 (178)
116 PF11722 zf-TRM13_CCCH: CCCH z 29.4 30 0.00065 27.9 1.2 21 589-609 11-31 (31)
117 KOG2461 Transcription factor B 27.7 73 0.0016 39.8 4.8 81 968-1054 315-395 (396)
118 cd05839 BR140_related The PWWP 27.4 92 0.002 32.3 4.6 61 157-217 6-80 (111)
119 smart00834 CxxC_CXXC_SSSS Puta 27.2 20 0.00043 29.6 -0.1 11 985-995 6-16 (41)
120 PHA00626 hypothetical protein 26.8 22 0.00048 32.3 0.1 13 1018-1030 23-35 (59)
121 PF06524 NOA36: NOA36 protein; 25.8 40 0.00087 39.2 1.9 11 846-856 62-72 (314)
122 TIGR02605 CxxC_CxxC_SSSS putat 25.4 24 0.00053 30.9 0.1 11 985-995 6-16 (52)
123 PF09723 Zn-ribbon_8: Zinc rib 25.3 21 0.00046 30.4 -0.3 12 985-996 6-17 (42)
124 PRK00464 nrdR transcriptional 25.3 26 0.00057 38.1 0.4 40 985-1030 1-40 (154)
125 PF12013 DUF3505: Protein of u 25.2 61 0.0013 32.9 2.9 24 916-939 81-108 (109)
126 TIGR02300 FYDLN_acid conserved 24.8 43 0.00093 35.3 1.7 30 985-1031 10-39 (129)
127 PF08879 WRC: WRC; InterPro: 24.8 26 0.00056 30.8 0.1 20 589-608 13-32 (46)
128 COG1997 RPL43A Ribosomal prote 24.1 31 0.00067 34.1 0.5 32 983-1030 34-65 (89)
129 PF02892 zf-BED: BED zinc fing 24.0 58 0.0013 27.6 2.1 28 981-1008 13-44 (45)
130 COG1198 PriA Primosomal protei 24.0 51 0.0011 44.1 2.7 25 1016-1055 460-484 (730)
131 TIGR00622 ssl1 transcription f 23.6 57 0.0012 33.8 2.3 24 1018-1041 81-104 (112)
132 COG1996 RPC10 DNA-directed RNA 23.4 41 0.00089 30.0 1.1 29 983-1027 5-33 (49)
133 PRK14890 putative Zn-ribbon RN 22.9 53 0.0011 30.3 1.7 32 983-1026 24-56 (59)
134 PF08666 SAF: SAF domain; Int 21.7 53 0.0011 29.4 1.5 15 1493-1507 3-17 (63)
135 PF14353 CpXC: CpXC protein 21.3 34 0.00074 35.6 0.3 20 983-1002 37-56 (128)
136 COG2888 Predicted Zn-ribbon RN 21.2 61 0.0013 30.0 1.7 33 983-1026 26-58 (61)
137 cd05834 HDGF_related The PWWP 21.1 1.2E+02 0.0026 29.7 3.9 52 157-218 8-60 (83)
138 KOG1280 Uncharacterized conser 20.8 57 0.0012 39.5 1.9 29 982-1010 77-105 (381)
139 PF13717 zinc_ribbon_4: zinc-r 20.5 66 0.0014 26.6 1.7 14 986-999 4-17 (36)
140 KOG2593 Transcription initiati 20.4 58 0.0012 40.6 1.9 47 972-1027 116-162 (436)
141 smart00531 TFIIE Transcription 20.4 58 0.0013 35.0 1.8 39 957-995 96-134 (147)
No 1
>KOG1082 consensus Histone H3 (Lys9) methyltransferase SUV39H1/Clr4, required for transcriptional silencing [Chromatin structure and dynamics; Transcription]
Probab=100.00 E-value=9.9e-43 Score=412.88 Aligned_cols=274 Identities=34% Similarity=0.531 Sum_probs=214.7
Q ss_pred CcCCCCceeeecCCCCCCCCCeeEeeCCCCcccccccCCCCCcccccCCCCCCCcEEeccCCCCCCCCCcccCCCCCccc
Q 000417 1225 KPLLRGTVLCDDISSGLESVPVACVVDDGLLETLCISADSSDSQKTRCSMPWESFTYVTKPLLDQSLDLDAESLQLGCAC 1304 (1534)
Q Consensus 1225 ~~~~~~~~i~~DIS~G~E~vPV~~vnd~D~~~~~~~~g~~~~~~~~~~~~P~~~F~Yi~~~~~~~~~~~d~e~~~~GC~C 1304 (1534)
..+.+...+..||+.|.|++||+.+|++|.. .| ..|+|++..++..+. ........||.|
T Consensus 53 ~~~~~~~~~~~d~~~~~e~~~v~~~n~id~~------------------~~-~~f~y~~~~~~~~~~-~~~~~~~~~c~C 112 (364)
T KOG1082|consen 53 KDKLEAKSELEDIALGSENLPVPLVNRIDED------------------AP-LYFQYIATEIVDPGE-LSDCENSTGCRC 112 (364)
T ss_pred ccccccccccccccCccccCceeeeeeccCC------------------cc-ccceeccccccCccc-cccCccccCCCc
Confidence 4455677889999999999999999999863 12 579999999887752 222345689999
Q ss_pred CCCCcCCCC---CCcccccccccccccccCCCCcCCCcccCCCCc--eeecCCceEEecCCCCCCCCCCCCcccccCcee
Q 000417 1305 ANSTCFPET---CDHVYLFDNDYEDAKDIDGKSVHGRFPYDQTGR--VILEEGYLIYECNHMCSCDRTCPNRVLQNGVRV 1379 (1534)
Q Consensus 1305 ~~~~C~p~~---C~C~~l~~~~y~~~~~i~g~~~~g~~~Yd~~G~--l~~~~~~~IyECn~~C~C~~~C~NRvvQ~g~~~ 1379 (1534)
.+ .|.... |.|.. .+.+.++|..+|. .....+.+||||++.|+|++.|.|||+|.|++.
T Consensus 113 ~~-~~~~~~~~~C~C~~---------------~n~~~~~~~~~~~~~~~~~~~~~i~EC~~~C~C~~~C~nRv~q~g~~~ 176 (364)
T KOG1082|consen 113 CS-SCSSVLPLTCLCER---------------HNGGLVAYTCDGDCGTLGKFKEPVFECSVACGCHPDCANRVVQKGLQF 176 (364)
T ss_pred cC-CCCCCCCccccChH---------------hhCCccccccCCccccccccCccccccccCCCCCCcCcchhhcccccc
Confidence 86 444332 67643 2335567776663 334456799999999999999999999999999
Q ss_pred eEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhccccCC----CcceEEecCccccc--------ccccc
Q 000417 1380 KLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRSRYGRD----GCGYMLNIGAHIND--------MGRLI 1447 (1534)
Q Consensus 1380 ~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~~y~~~----~~sYlf~ld~~~~d--------~~~l~ 1447 (1534)
+|+||+|+.+|||||++++|++|+|||||+||+++..+++.|...+... +..+.+..+..... .....
T Consensus 177 ~leIfrt~~kGwgvRs~~~I~~G~fvcEyaGe~~t~~e~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 256 (364)
T KOG1082|consen 177 HLEVFRTPEKGWGVRTLDPIPAGEFVCEYAGEVLTSEEAQRRTHLREYLDDDCDAYSIADREWVDESPVGNTFVAPSLPG 256 (364)
T ss_pred ceEEEecCCceeeecccccccCCCeeEEEeeEecChHHhhhccccccccccccccchhhhcccccccccccccccccccc
Confidence 9999999999999999999999999999999999999999875432221 11122222211000 00111
Q ss_pred cCceeEEEeccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCCC-----------C
Q 000417 1448 EGQVRYVIDATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYELL-----------S 1516 (1534)
Q Consensus 1448 ~~~~~~~IDA~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~~-----------~ 1516 (1534)
.....++|||+.+||++|||||||.||+.++.|+.++.++..++|+|||++||+||||||||||..+. .
T Consensus 257 ~~~~~~~ida~~~GNv~RfinHSC~PN~~~~~v~~~~~~~~~~~i~ffa~~~I~p~~ELT~dYg~~~~~~~~~~~~~~~~ 336 (364)
T KOG1082|consen 257 GPGRELLIDAKPHGNVARFINHSCSPNLLYQAVFQDEFVLLYLRIGFFALRDISPGEELTLDYGKAYKLLVQDGANIYTP 336 (364)
T ss_pred CCCcceEEchhhcccccccccCCCCccceeeeeeecCCccchheeeeeeccccCCCcccchhhccccccccccccccccc
Confidence 22468999999999999999999999999999999999999999999999999999999999997753 2
Q ss_pred CCCceeeCCCCCCccccC
Q 000417 1517 GEGYPCHCGASKCRGRLY 1534 (1534)
Q Consensus 1517 ~~~~~C~CGS~~CRG~l~ 1534 (1534)
.....|.||+.+||++++
T Consensus 337 ~~~~~c~c~~~~cr~~~~ 354 (364)
T KOG1082|consen 337 VMKKNCNCGLEKCRGLLG 354 (364)
T ss_pred ccchhhcCCCHHhCcccC
Confidence 246789999999999874
No 2
>KOG4442 consensus Clathrin coat binding protein/Huntingtin interacting protein HIP1, involved in regulation of endocytosis [Intracellular trafficking, secretion, and vesicular transport]
Probab=100.00 E-value=2.3e-38 Score=379.58 Aligned_cols=163 Identities=42% Similarity=0.780 Sum_probs=152.3
Q ss_pred eEEecCC-CCC-CCCCCCCcccccCceeeEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhccccCCC--
Q 000417 1354 LIYECNH-MCS-CDRTCPNRVLQNGVRVKLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRSRYGRDG-- 1429 (1534)
Q Consensus 1354 ~IyECn~-~C~-C~~~C~NRvvQ~g~~~~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~~y~~~~-- 1429 (1534)
...||++ .|. |+..|.|+.+|+....+++||.|+.+||||||.++|++|+||+||.||||+..|+++|...|...+
T Consensus 93 t~iECs~~~C~~cg~~C~NQRFQkkqyA~vevF~Te~KG~GLRA~~dI~~g~FI~EY~GEVI~~~Ef~kR~~~Y~~d~~k 172 (729)
T KOG4442|consen 93 TSIECSDRECPRCGVYCKNQRFQKKQYAKVEVFLTEKKGCGLRAEEDIPKGQFILEYIGEVIEEKEFEKRVKRYAKDGIK 172 (729)
T ss_pred hhcccCCccCCCccccccchhhhhhccCceeEEEecCcccceeeccccCCCcEEeeeccccccHHHHHHHHHHHHhcCCc
Confidence 3469998 999 999999999999999999999999999999999999999999999999999999999999997764
Q ss_pred cceEEecCcccccccccccCceeEEEeccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEE
Q 000417 1430 CGYMLNIGAHINDMGRLIEGQVRYVIDATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYD 1509 (1534)
Q Consensus 1430 ~sYlf~ld~~~~d~~~l~~~~~~~~IDA~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~D 1509 (1534)
+.|+|.+.. .++|||+.+||+||||||||+|||.++.|.|. +..||+|||.|+|++|||||||
T Consensus 173 h~Yfm~L~~-------------~e~IDAT~KGnlaRFiNHSC~PNa~~~KWtV~----~~lRvGiFakk~I~~GEEITFD 235 (729)
T KOG4442|consen 173 HYYFMALQG-------------GEYIDATKKGNLARFINHSCDPNAEVQKWTVP----DELRVGIFAKKVIKPGEEITFD 235 (729)
T ss_pred eEEEEEecC-------------CceecccccCcHHHhhcCCCCCCceeeeeeeC----CeeEEEEeEecccCCCceeeEe
Confidence 346665543 68999999999999999999999999999998 6899999999999999999999
Q ss_pred cCCCCCCCCCceeeCCCCCCcccc
Q 000417 1510 YHYELLSGEGYPCHCGASKCRGRL 1533 (1534)
Q Consensus 1510 Yg~~~~~~~~~~C~CGS~~CRG~l 1533 (1534)
|+++....+..+|+||+++|||||
T Consensus 236 Yqf~rYGr~AQ~CyCgeanC~G~I 259 (729)
T KOG4442|consen 236 YQFDRYGRDAQPCYCGEANCRGWI 259 (729)
T ss_pred cccccccccccccccCCccccccc
Confidence 999998888999999999999997
No 3
>KOG1141 consensus Predicted histone methyl transferase [Chromatin structure and dynamics]
Probab=100.00 E-value=7.9e-39 Score=381.21 Aligned_cols=199 Identities=23% Similarity=0.339 Sum_probs=142.7
Q ss_pred cccCCCCcCCc-ccccccee-eeccc-------cc---------CCCcCCCCceeeecCCCCCCCCCeeEeeCCCCcccc
Q 000417 1197 SSDSSDFVNNQ-WEVDECHC-IIDSR-------HL---------GRKPLLRGTVLCDDISSGLESVPVACVVDDGLLETL 1258 (1534)
Q Consensus 1197 ~v~~~~~~~~~-~~~~e~~~-~l~~~-------~~---------~~~~~~~~~~i~~DIS~G~E~vPV~~vnd~D~~~~~ 1258 (1534)
-|.|..|||.- +.|.|+.+ +++.+ .| +..++.++++.|-||++|+|.+||.++|+.|..
T Consensus 620 hv~yktpcg~~lr~~~el~ryL~et~c~flf~~~f~~~~yV~~~r~~~p~kp~~~~~Di~~g~e~vpis~~neids~--- 696 (1262)
T KOG1141|consen 620 HVEYKTPCGMPLRMRIELYRYLVETRCKFLFVIGFDRAFYVVRHRAPNPLKPGNRCTDIPCGREHVPISEKNEIDSH--- 696 (1262)
T ss_pred eeeccCCCccchHHHHHHHHHHHHhcCcEEEEeecccchheeecccCCCcCCcceeccccCCccccccceeecccCc---
Confidence 37799999988 77777554 33332 12 233466888999999999999999999999852
Q ss_pred cccCCCCCcccccCCCCCCCcEEeccCCCCCCCCCc-ccCCCCCcccCCCCcCCCCCCcccccccccccccccCCC-CcC
Q 000417 1259 CISADSSDSQKTRCSMPWESFTYVTKPLLDQSLDLD-AESLQLGCACANSTCFPETCDHVYLFDNDYEDAKDIDGK-SVH 1336 (1534)
Q Consensus 1259 ~~~g~~~~~~~~~~~~P~~~F~Yi~~~~~~~~~~~d-~e~~~~GC~C~~~~C~p~~C~C~~l~~~~y~~~~~i~g~-~~~ 1336 (1534)
|++.|.|-...+.....=.+ ...|+.+|+|.+|+-+..+|.|.++....-.. .-++. ...
T Consensus 697 ----------------~lpq~ay~K~~ip~~~nl~n~~~~fl~scdc~~gcid~~kcachQltvk~~~t--~p~~~v~~t 758 (1262)
T KOG1141|consen 697 ----------------RLPQAAYKKHMIPTNNNLSNRRKDFLQSCDCPTGCIDSMKCACHQLTVKKKTT--GPNQNVAST 758 (1262)
T ss_pred ----------------CCccchhheeeccCCCcccccChhhhhcCCCCcchhhhhhhhHHHHHHHhhcc--CCCcccccC
Confidence 23578887776655432111 24578999999865566789998764321100 00000 001
Q ss_pred CCcccCCCCceeecCCceEEecCCCCCCCC-CCCCcccccCceeeEEEEecCCCCccccccccccCCCeEEEeeeEeecH
Q 000417 1337 GRFPYDQTGRVILEEGYLIYECNHMCSCDR-TCPNRVLQNGVRVKLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDE 1415 (1534)
Q Consensus 1337 g~~~Yd~~G~l~~~~~~~IyECn~~C~C~~-~C~NRvvQ~g~~~~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~ 1415 (1534)
..+.|. |++-.....+|||+..|+|.+ -|.||++|+|.+++|++|+|..+|||+|..++|.+|.|||.|.|-+++.
T Consensus 759 ~gykyK---Rl~e~~ptg~yEc~k~ckc~~~~C~nrmvqhg~qvRlq~fkt~~kGWg~rclddi~~g~fVciy~g~~l~~ 835 (1262)
T KOG1141|consen 759 NGYKYK---RLIEIRPTGPYECLKACKCCGPDCLNRMVQHGYQVRLQRFKTIHKGWGRRCLDDITGGNFVCIYPGGALLH 835 (1262)
T ss_pred cchhhH---HHHHhcCCCHHHHHHhhccCcHHHHHHHhhcCceeEeeeccccccccceEeeeecCCceEEEEecchhhhh
Confidence 123332 333333457999999999987 5999999999999999999999999999999999999999999999865
Q ss_pred HHHH
Q 000417 1416 LETN 1419 (1534)
Q Consensus 1416 ~ea~ 1419 (1534)
.-++
T Consensus 836 ~~sd 839 (1262)
T KOG1141|consen 836 QISD 839 (1262)
T ss_pred hhch
Confidence 5443
No 4
>KOG1080 consensus Histone H3 (Lys4) methyltransferase complex, subunit SET1 and related methyltransferases [Chromatin structure and dynamics; Transcription]
Probab=99.94 E-value=2e-27 Score=303.09 Aligned_cols=137 Identities=42% Similarity=0.738 Sum_probs=125.9
Q ss_pred eeEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhccccCC--CcceEEecCcccccccccccCceeEEEe
Q 000417 1379 VKLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRSRYGRD--GCGYMLNIGAHINDMGRLIEGQVRYVID 1456 (1534)
Q Consensus 1379 ~~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~~y~~~--~~sYlf~ld~~~~d~~~l~~~~~~~~ID 1456 (1534)
..|...++..+||||||+++|.+|++|+||+||++...-|+.|+.+|... +.+|+|.+|. .++||
T Consensus 866 k~~~F~~s~iH~wglfa~~~i~~~dmViEY~Ge~vR~~iad~RE~~Y~~~gi~~sYlfrid~-------------~~ViD 932 (1005)
T KOG1080|consen 866 KYVKFGRSGIHGWGLFAMENIAAGDMVIEYRGELVRSSIADLREARYERMGIGDSYLFRIDD-------------EVVVD 932 (1005)
T ss_pred hhhccccccccccceeeccCccccceEEEeeceehhhhHHHHHHHHHhccCcccceeeeccc-------------ceEEe
Confidence 34777789999999999999999999999999999999999999888765 4789999986 58999
Q ss_pred ccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCCCCCCCceeeCCCCCCcccc
Q 000417 1457 ATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYELLSGEGYPCHCGASKCRGRL 1533 (1534)
Q Consensus 1457 A~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~~~~~~~~C~CGS~~CRG~l 1533 (1534)
|+..||+||||||||+|||.+..+.|+ +..+|+|||.|||.+||||||||.+.... ...+|+|||++|||+|
T Consensus 933 Atk~gniAr~InHsC~PNCyakvi~V~----g~~~IvIyakr~I~~~EElTYDYkF~~e~-~kipClCgap~Crg~~ 1004 (1005)
T KOG1080|consen 933 ATKKGNIARFINHSCNPNCYAKVITVE----GDKRIVIYSKRDIAAGEELTYDYKFPTED-DKIPCLCGAPNCRGFL 1004 (1005)
T ss_pred ccccCchhheeecccCCCceeeEEEec----CeeEEEEEEecccccCceeeeeccccccc-cccccccCCCcccccc
Confidence 999999999999999999999999999 67799999999999999999999988654 3899999999999997
No 5
>KOG1079 consensus Transcriptional repressor EZH1 [Transcription]
Probab=99.93 E-value=1.7e-26 Score=276.13 Aligned_cols=132 Identities=34% Similarity=0.659 Sum_probs=126.8
Q ss_pred CCCCcccccCceeeEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhccccCCCcceEEecCccccccccc
Q 000417 1367 TCPNRVLQNGVRVKLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRSRYGRDGCGYMLNIGAHINDMGRL 1446 (1534)
Q Consensus 1367 ~C~NRvvQ~g~~~~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~~y~~~~~sYlf~ld~~~~d~~~l 1446 (1534)
+|.|--+|+|.+.++.+..+...|||+|+.+.+.+++||.||+||+|+.+||++|+..|+....+|||++..
T Consensus 582 ~C~N~~l~~~~qkr~llapSdVaGwGlFlKe~v~KnefisEY~GE~IS~dEADrRGkiYDr~~cSflFnln~-------- 653 (739)
T KOG1079|consen 582 SCKNTNLQRGEQKRVLLAPSDVAGWGLFLKESVSKNEFISEYTGEIISHDEADRRGKIYDRYMCSFLFNLNN-------- 653 (739)
T ss_pred ccccchhhhhhhcceeechhhccccceeeccccCCCceeeeecceeccchhhhhcccccccccceeeeeccc--------
Confidence 799999999999999999999999999999999999999999999999999999999999999999999876
Q ss_pred ccCceeEEEeccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCCC
Q 000417 1447 IEGQVRYVIDATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYELL 1515 (1534)
Q Consensus 1447 ~~~~~~~~IDA~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~~ 1515 (1534)
.|+|||++.||.+||+|||=+|||.+..+++. +..+|+|||.|+|.+||||||||+|+-.
T Consensus 654 -----dyviDs~rkGnk~rFANHS~nPNCYAkvm~V~----GdhRIGifAkRaIeagEELffDYrYs~~ 713 (739)
T KOG1079|consen 654 -----DYVIDSTRKGNKIRFANHSFNPNCYAKVMMVA----GDHRIGIFAKRAIEAGEELFFDYRYSPE 713 (739)
T ss_pred -----cceEeeeeecchhhhccCCCCCCcEEEEEEec----CCcceeeeehhhcccCceeeeeeccCcc
Confidence 59999999999999999999999999988888 7889999999999999999999998753
No 6
>KOG2462 consensus C2H2-type Zn-finger protein [Transcription]
Probab=99.86 E-value=6.8e-23 Score=226.88 Aligned_cols=137 Identities=18% Similarity=0.211 Sum_probs=109.2
Q ss_pred CccccCccCcccCChHHHHhHhhhcccccccccccccccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCC
Q 000417 880 RGYACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGED 959 (1534)
Q Consensus 880 kpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geK 959 (1534)
..|+|..|+|.+.+.++|.+|.++|..... .+-+.|++|+|.|.+...|+.| .++|+
T Consensus 129 ~r~~c~eCgk~ysT~snLsrHkQ~H~~~~s---~ka~~C~~C~K~YvSmpALkMH-irTH~------------------- 185 (279)
T KOG2462|consen 129 PRYKCPECGKSYSTSSNLSRHKQTHRSLDS---KKAFSCKYCGKVYVSMPALKMH-IRTHT------------------- 185 (279)
T ss_pred Cceeccccccccccccccchhhcccccccc---cccccCCCCCceeeehHHHhhH-hhccC-------------------
Confidence 447777777777777777777777665433 2567888888888888888888 55554
Q ss_pred CCccccCCCchhhhhhhhhcCCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccc
Q 000417 960 SPKKLELGYSASVENHSENLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPR 1039 (1534)
Q Consensus 960 p~~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r 1039 (1534)
-+++|.+|||.|.+..-|+- |+|+||| ||||.|+.|+|+|..+++|+.||+
T Consensus 186 -----------------------l~c~C~iCGKaFSRPWLLQG-HiRTHTG-----EKPF~C~hC~kAFADRSNLRAHmQ 236 (279)
T KOG2462|consen 186 -----------------------LPCECGICGKAFSRPWLLQG-HIRTHTG-----EKPFSCPHCGKAFADRSNLRAHMQ 236 (279)
T ss_pred -----------------------CCcccccccccccchHHhhc-ccccccC-----CCCccCCcccchhcchHHHHHHHH
Confidence 56788888888888888888 7888888 888888888888888888888888
Q ss_pred cccCCCCccCCCCCCcCCChHHHHhhccc
Q 000417 1040 FKKGLGAVSYRIRNRGAAGMKKRIQTLKP 1068 (1534)
Q Consensus 1040 ~H~gekpy~C~iCgksFs~~~~L~kH~Ks 1068 (1534)
+|.+.|+|+|..|+|+|+.++.|.+|..+
T Consensus 237 THS~~K~~qC~~C~KsFsl~SyLnKH~ES 265 (279)
T KOG2462|consen 237 THSDVKKHQCPRCGKSFALKSYLNKHSES 265 (279)
T ss_pred hhcCCccccCcchhhHHHHHHHHHHhhhh
Confidence 88888888888888888888888888764
No 7
>smart00317 SET SET (Su(var)3-9, Enhancer-of-zeste, Trithorax) domain. Putative methyl transferase, based on outlier plant homologues
Probab=99.85 E-value=3.9e-21 Score=189.61 Aligned_cols=114 Identities=47% Similarity=0.790 Sum_probs=97.1
Q ss_pred eEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhccccCCC--cceEEecCcccccccccccCceeEEEec
Q 000417 1380 KLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRSRYGRDG--CGYMLNIGAHINDMGRLIEGQVRYVIDA 1457 (1534)
Q Consensus 1380 ~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~~y~~~~--~sYlf~ld~~~~d~~~l~~~~~~~~IDA 1457 (1534)
++++++++.+|+||+|+++|++|++|++|.|.++...++..+...+.... ..|+|.... .++||+
T Consensus 1 ~~~~~~~~~~G~gl~a~~~i~~g~~i~~~~g~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-------------~~~id~ 67 (116)
T smart00317 1 KLEVFKSPGKGWGVRATEDIPKGEFIGEYVGEIITSEEAEERSKAYDTDGADSFYLFEIDS-------------DLCIDA 67 (116)
T ss_pred CcEEEecCCCcEEEEECCccCCCCEEEEEEeEEECHHHHHHHHHHHHhcCCCCEEEEECCC-------------CEEEeC
Confidence 36788899999999999999999999999999999888877653232222 367777543 579999
Q ss_pred cccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEc
Q 000417 1458 TKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDY 1510 (1534)
Q Consensus 1458 ~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DY 1510 (1534)
...||++|||||||.||+.+..+..+ +..++.|+|+|||++|||||+||
T Consensus 68 ~~~~~~~~~iNHsc~pN~~~~~~~~~----~~~~~~~~a~r~I~~GeEi~i~Y 116 (116)
T smart00317 68 RRKGNIARFINHSCEPNCELLFVEVN----GDSRIVIFALRDIKPGEELTIDY 116 (116)
T ss_pred CccCcHHHeeCCCCCCCEEEEEEEEC----CCcEEEEEECCCcCCCCEEeecC
Confidence 99999999999999999999888775 34489999999999999999999
No 8
>KOG2462 consensus C2H2-type Zn-finger protein [Transcription]
Probab=99.84 E-value=1e-21 Score=217.60 Aligned_cols=141 Identities=20% Similarity=0.346 Sum_probs=126.4
Q ss_pred ccCCCcccCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcccccccccccccccccC
Q 000417 842 SEDEKTHKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPC 921 (1534)
Q Consensus 842 h~gekpykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~C 921 (1534)
......|+|+.|+|.+.+.++|.+| +.+|..-. ..+.+.|++|+|.|.+...|+.|+++|+ .+++|.+|
T Consensus 125 ~~~~~r~~c~eCgk~ysT~snLsrH-kQ~H~~~~--s~ka~~C~~C~K~YvSmpALkMHirTH~--------l~c~C~iC 193 (279)
T KOG2462|consen 125 AAKHPRYKCPECGKSYSTSSNLSRH-KQTHRSLD--SKKAFSCKYCGKVYVSMPALKMHIRTHT--------LPCECGIC 193 (279)
T ss_pred cccCCceeccccccccccccccchh-hccccccc--ccccccCCCCCceeeehHHHhhHhhccC--------CCcccccc
Confidence 3455679999999999999999999 88997642 2378999999999999999999999987 35789999
Q ss_pred CCccCChHHHhhhhhccccCcccchhhhhhcccccCCCCCccccCCCchhhhhhhhhcCCcceeeecccCCccCChhHHH
Q 000417 922 GSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSPKKLELGYSASVENHSENLGSIRKFICRFCGLKFDLLPDLG 1001 (1534)
Q Consensus 922 gK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKsF~sks~Lk 1001 (1534)
||.|...-.|+-| +|+|+|||||.|+.|+|.|..+++|+
T Consensus 194 GKaFSRPWLLQGH-----------------------------------------iRTHTGEKPF~C~hC~kAFADRSNLR 232 (279)
T KOG2462|consen 194 GKAFSRPWLLQGH-----------------------------------------IRTHTGEKPFSCPHCGKAFADRSNLR 232 (279)
T ss_pred cccccchHHhhcc-----------------------------------------cccccCCCCccCCcccchhcchHHHH
Confidence 9999987776666 67889999999999999999999999
Q ss_pred HHHHhhccCCCCCCCCCcccCCCCcccCCchhhhccccc
Q 000417 1002 RHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRF 1040 (1534)
Q Consensus 1002 rHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~ 1040 (1534)
. |+++|.+ .|+|+|+.|+|.|..++.|.+|...
T Consensus 233 A-HmQTHS~-----~K~~qC~~C~KsFsl~SyLnKH~ES 265 (279)
T KOG2462|consen 233 A-HMQTHSD-----VKKHQCPRCGKSFALKSYLNKHSES 265 (279)
T ss_pred H-HHHhhcC-----CccccCcchhhHHHHHHHHHHhhhh
Confidence 9 8999999 8999999999999999999999743
No 9
>KOG1083 consensus Putative transcription factor ASH1/LIN-59 [Transcription]
Probab=99.81 E-value=2.8e-21 Score=238.37 Aligned_cols=131 Identities=43% Similarity=0.714 Sum_probs=117.1
Q ss_pred CCCCccccc-CceeeEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHH-hccccCCCcceEEecCccccccc
Q 000417 1367 TCPNRVLQN-GVRVKLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKR-RSRYGRDGCGYMLNIGAHINDMG 1444 (1534)
Q Consensus 1367 ~C~NRvvQ~-g~~~~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R-~~~y~~~~~sYlf~ld~~~~d~~ 1444 (1534)
+|.|+.+|+ +.-.+|+||+.+.+||||+|.++|++|+||+||+|||++..+.+.+ ...|-...+.|+..++.
T Consensus 1165 ~c~nqrm~r~e~cp~L~v~~gp~~G~~v~tk~PikagtfI~EYvGeVit~ke~e~~mmtl~~~d~~~~cL~I~p------ 1238 (1306)
T KOG1083|consen 1165 SCSNQRMQRHEECPPLEVFRGPKKGWGVRTKEPIKAGTFIMEYVGEVITEKEFEPRMMTLYHNDDDHYCLVIDP------ 1238 (1306)
T ss_pred hhhhHHhhhhccCCCcceeccCCCCccccccccccccchHHHHHHHHHHHHhhcccccccCCCCCcccccccCc------
Confidence 377776664 6677899999999999999999999999999999999999998877 34466667778888776
Q ss_pred ccccCceeEEEeccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCC
Q 000417 1445 RLIEGQVRYVIDATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYEL 1514 (1534)
Q Consensus 1445 ~l~~~~~~~~IDA~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~ 1514 (1534)
..+||+.++||.+|||||||.|||..+.|.++ ++.||++||+|||.+||||||||+...
T Consensus 1239 -------~l~id~~R~~n~~RfinhscKPNc~~qkwSVN----G~~Rv~L~A~rDi~kGEELtYDYN~ks 1297 (1306)
T KOG1083|consen 1239 -------GLFIDIPRMGNGARFINHSCKPNCEMQKWSVN----GEYRVGLFALRDLPKGEELTYDYNFKS 1297 (1306)
T ss_pred -------cccCChhhccccccccccccCCCCcccccccc----ceeeeeeeecCCCCCCceEEEeccccc
Confidence 57999999999999999999999999999999 899999999999999999999998653
No 10
>KOG3608 consensus Zn finger proteins [General function prediction only]
Probab=99.73 E-value=5e-19 Score=199.03 Aligned_cols=189 Identities=19% Similarity=0.219 Sum_probs=164.4
Q ss_pred cccCC--CCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcccccccccccccccccCCCc
Q 000417 847 THKCK--ICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSH 924 (1534)
Q Consensus 847 pykC~--~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~ 924 (1534)
.+.|. -|-+.|.++..|++| .++|+++ |...|+.|+.-|.++..|.-|.+..+.-.. .+|+|..|.|.
T Consensus 177 v~~C~W~~Ct~~~~~k~~LreH-~r~Hs~e-----KvvACp~Cg~~F~~~tkl~DH~rRqt~l~~----n~fqC~~C~Kr 246 (467)
T KOG3608|consen 177 VTMCNWAMCTKHMGNKYRLREH-IRTHSNE-----KVVACPHCGELFRTKTKLFDHLRRQTELNT----NSFQCAQCFKR 246 (467)
T ss_pred eeeccchhhhhhhccHHHHHHH-HHhcCCC-----eEEecchHHHHhccccHHHHHHHhhhhhcC----CchHHHHHHHH
Confidence 36664 699999999999999 8999999 899999999999999999999987765432 58999999999
Q ss_pred cCChHHHhhhhhccccCcccchhhhhhcccccCCCCCccccCCCchhhhhhhh-hcCCcceeeecccCCccCChhHHHHH
Q 000417 925 FGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSPKKLELGYSASVENHSE-NLGSIRKFICRFCGLKFDLLPDLGRH 1003 (1534)
Q Consensus 925 Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~~C~~Cgk~~sLk~Hlr-tHtgeKpykC~~CgKsF~sks~LkrH 1003 (1534)
|.++..|..| ++.|..-|+|+.|... |+..++|.+|++ .|...|||+|+.|++.|.+.++|.+
T Consensus 247 FaTeklL~~H-v~rHvn~ykCplCdmt--------------c~~~ssL~~H~r~rHs~dkpfKCd~Cd~~c~~esdL~k- 310 (467)
T KOG3608|consen 247 FATEKLLKSH-VVRHVNCYKCPLCDMT--------------CSSASSLTTHIRYRHSKDKPFKCDECDTRCVRESDLAK- 310 (467)
T ss_pred HhHHHHHHHH-HHHhhhcccccccccC--------------CCChHHHHHHHHhhhccCCCccccchhhhhccHHHHHH-
Confidence 9999999999 7778755666555432 556789999997 5889999999999999999999999
Q ss_pred HHhhccCCCCCCCCCcccCC--CCcccCCchhhhccccccc-CC--CCccCCCCCCcCCChHHHHhhcc
Q 000417 1004 HQAAHMGPNLVNSRPHKKGI--RFYAYKLKSGRLSRPRFKK-GL--GAVSYRIRNRGAAGMKKRIQTLK 1067 (1534)
Q Consensus 1004 H~rtHtge~~~~eKpYkC~i--C~K~F~sks~L~rH~r~H~-ge--kpy~C~iCgksFs~~~~L~kH~K 1067 (1534)
|..+|.. -.|+|+. |.++|++...|++|++.|+ |. -+|+|..|++.|.+-.+|..|..
T Consensus 311 H~~~HS~------~~y~C~h~~C~~s~r~~~q~~~H~~evhEg~np~~Y~CH~Cdr~ft~G~~L~~HL~ 373 (467)
T KOG3608|consen 311 HVQVHSK------TVYQCEHPDCHYSVRTYTQMRRHFLEVHEGNNPILYACHCCDRFFTSGKSLSAHLM 373 (467)
T ss_pred HHHhccc------cceecCCCCCcHHHHHHHHHHHHHHHhccCCCCCceeeecchhhhccchhHHHHHH
Confidence 6779985 4799998 9999999999999997655 55 55999999999999999999965
No 11
>KOG1074 consensus Transcriptional repressor SALM [Transcription]
Probab=99.69 E-value=9.6e-18 Score=205.05 Aligned_cols=218 Identities=17% Similarity=0.191 Sum_probs=153.6
Q ss_pred CCcccCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcccccccccccccccc---cC
Q 000417 845 EKTHKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCI---PC 921 (1534)
Q Consensus 845 ekpykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~---~C 921 (1534)
-.|-+|-+|-++...++.|+.| .++|++| |||+|++|++.|.++.+|+.||-.|....... -.|.|+ +|
T Consensus 603 TdPNqCiiC~rVlSC~saLqmH-yrtHtGE-----RPFkCKiCgRAFtTkGNLkaH~~vHka~p~~R--~q~ScP~~~ic 674 (958)
T KOG1074|consen 603 TDPNQCIICLRVLSCPSALQMH-YRTHTGE-----RPFKCKICGRAFTTKGNLKAHMSVHKAKPPAR--VQFSCPSTFIC 674 (958)
T ss_pred CCccceeeeeecccchhhhhhh-hhcccCc-----CccccccccchhccccchhhcccccccCcccc--ccccCCchhhh
Confidence 4578999999999999999999 8999999 99999999999999999999999888765554 679999 99
Q ss_pred CCccCChHHHhhhhhccccCc---------------ccchhhhhhcccccCCC---------------------------
Q 000417 922 GSHFGNTEELWLHVQSVHAID---------------FKMSEVAQQHNQSVGED--------------------------- 959 (1534)
Q Consensus 922 gK~Fssk~~Lk~H~~rvH~~e---------------f~C~~C~k~f~~~~geK--------------------------- 959 (1534)
.+.|.+.-.|..| .++|.+. -+|..|.+.|.......
T Consensus 675 ~~kftn~V~lpQh-IriH~~~~~s~g~~a~e~~~~adq~~~~qk~~~~a~~f~~~~se~~~~~s~~~~~~~~~t~t~~~~ 753 (958)
T KOG1074|consen 675 QKKFTNAVTLPQH-IRIHLGGQISNGGTAAEGILAADQCSSCQKTFSDARSFSQQISEQPSPESEPDEQMDERTETEELD 753 (958)
T ss_pred cccccccccccce-EEeecCCCCCCCcccccccchhcccchhhhcccccccchhhhhccCCcccCCcccccccccccccc
Confidence 9999999999999 7888632 46777777664221111
Q ss_pred ---CCccccCCCchh---------------------------hhhhhhhcCCccee-eecccCCccCChhHHH----HH-
Q 000417 960 ---SPKKLELGYSAS---------------------------VENHSENLGSIRKF-ICRFCGLKFDLLPDLG----RH- 1003 (1534)
Q Consensus 960 ---p~~C~~Cgk~~s---------------------------Lk~HlrtHtgeKpy-kC~~CgKsF~sks~Lk----rH- 1003 (1534)
+..+..|+..+. -..+...++++++. .|.+|+..-...-... .-
T Consensus 754 ~tp~~~e~~~~~~~~~e~~i~~~g~te~asa~~~~vg~~s~~~~~~~~~~T~~k~~~~~~~~~~~~~~~v~~~pvl~~~~ 833 (958)
T KOG1074|consen 754 VTPPPPENSCGRELEGEMAISVRGSTEEASANLDEVGTVSAAGEAGEEDDTSEKPTQASSFPGEILAPSVNMDPVLWNQE 833 (958)
T ss_pred cCCCccccccccccCcccccccccchhhhhcChhhhcCccccchhhhhcccCCCCcccccCCCcCCccccccCchhhccc
Confidence 222333331110 01111223344444 4555543322211100 00
Q ss_pred ------------HHhhccCCC-------------------CCCCCCcccCCCCcccCCchhhhcccccccCCCCccCCCC
Q 000417 1004 ------------HQAAHMGPN-------------------LVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRIR 1052 (1534)
Q Consensus 1004 ------------H~rtHtge~-------------------~~~eKpYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~iC 1052 (1534)
-..+|.++. ........|.+|++.|...+.|..|+|+|+++|||.|.+|
T Consensus 834 ~~~l~eg~~t~~n~~t~~~~~~sv~qs~~~p~l~p~l~~~~pvnn~h~C~vCgk~FsSSsALqiH~rTHtg~KPF~C~fC 913 (958)
T KOG1074|consen 834 TSMLNEGLATKTNEITPEGPADSVIQSGGVPTLEPSLGRPGPVNNAHVCNVCGKQFSSSAALEIHMRTHTGPKPFFCHFC 913 (958)
T ss_pred ccccccccccccccccCCCcchhhhhhccccccCCCCCCCCcccchhhhccchhcccchHHHHHhhhcCCCCCCccchhh
Confidence 000000000 0002347899999999999999999999999999999999
Q ss_pred CCcCCChHHHHhhccccCC
Q 000417 1053 NRGAAGMKKRIQTLKPLAS 1071 (1534)
Q Consensus 1053 gksFs~~~~L~kH~KsH~~ 1071 (1534)
++.|..+..|+.|+.+|..
T Consensus 914 ~~aFttrgnLKvHMgtH~w 932 (958)
T KOG1074|consen 914 EEAFTTRGNLKVHMGTHMW 932 (958)
T ss_pred hhhhhhhhhhhhhhccccc
Confidence 9999999999999999864
No 12
>KOG1085 consensus Predicted methyltransferase (contains a SET domain) [General function prediction only]
Probab=99.69 E-value=4.2e-17 Score=179.62 Aligned_cols=128 Identities=38% Similarity=0.514 Sum_probs=109.8
Q ss_pred cccCceeeEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhccccCCC--cceEEecCcccccccccccCc
Q 000417 1373 LQNGVRVKLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRSRYGRDG--CGYMLNIGAHINDMGRLIEGQ 1450 (1534)
Q Consensus 1373 vQ~g~~~~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~~y~~~~--~sYlf~ld~~~~d~~~l~~~~ 1450 (1534)
+..|....|.+..-.+||.||+|...+.+|+||.||.|.+|...||..|+..|..+. -.|+|.+... .
T Consensus 250 vl~g~~egl~~~~~dgKGRGv~a~~~F~rgdFVVEY~Gdliei~eAk~rE~~Ya~De~~GcYMYyF~h~----------s 319 (392)
T KOG1085|consen 250 VLKGTNEGLLEVYKDGKGRGVRAKVNFERGDFVVEYRGDLIEISEAKVREEQYANDEEIGCYMYYFEHN----------S 319 (392)
T ss_pred HHhccccceeEEeeccccceeEeecccccCceEEEEecceeeechHHHHHHHhccCcccceEEEeeecc----------C
Confidence 345666677777777899999999999999999999999999999999998886543 3577765442 2
Q ss_pred eeEEEeccc-cCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCC
Q 000417 1451 VRYVIDATK-YGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYEL 1514 (1534)
Q Consensus 1451 ~~~~IDA~~-~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~ 1514 (1534)
..|||||+. .+-++|.||||-.+||....|.++ +.||+.+.|.|||.+||||+||||+..
T Consensus 320 k~yCiDAT~et~~lGRLINHS~~gNl~TKvv~Id----g~pHLiLvA~rdIa~GEELlYDYGDRS 380 (392)
T KOG1085|consen 320 KKYCIDATKETPWLGRLINHSVRGNLKTKVVEID----GSPHLILVARRDIAQGEELLYDYGDRS 380 (392)
T ss_pred eeeeeecccccccchhhhcccccCcceeeEEEec----CCceEEEEeccccccchhhhhhccccc
Confidence 479999987 566899999999999999999999 899999999999999999999999753
No 13
>KOG3608 consensus Zn finger proteins [General function prediction only]
Probab=99.67 E-value=1.5e-17 Score=187.32 Aligned_cols=192 Identities=18% Similarity=0.294 Sum_probs=164.1
Q ss_pred ccccccccCCCcccCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcccccccccccc
Q 000417 836 LAIAGRSEDEKTHKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVEQCML 915 (1534)
Q Consensus 836 ~~~~~~h~gekpykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kp 915 (1534)
.++.+.|+++|...|+.|+..|.++..|-.|+++.-... ..+|.|..|.|.|.++..|..|+..|-.-
T Consensus 196 reH~r~Hs~eKvvACp~Cg~~F~~~tkl~DH~rRqt~l~----~n~fqC~~C~KrFaTeklL~~Hv~rHvn~-------- 263 (467)
T KOG3608|consen 196 REHIRTHSNEKVVACPHCGELFRTKTKLFDHLRRQTELN----TNSFQCAQCFKRFATEKLLKSHVVRHVNC-------- 263 (467)
T ss_pred HHHHHhcCCCeEEecchHHHHhccccHHHHHHHhhhhhc----CCchHHHHHHHHHhHHHHHHHHHHHhhhc--------
Confidence 356689999999999999999999999999965443222 27899999999999999999999988654
Q ss_pred cccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCCCCccccCCCc----hhhhhhhhhcCCcceeeecc--
Q 000417 916 QQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSPKKLELGYS----ASVENHSENLGSIRKFICRF-- 989 (1534)
Q Consensus 916 ykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~~C~~Cgk~----~sLk~HlrtHtgeKpykC~~-- 989 (1534)
|+|+.|+.+....++|.+|++..|. ..||++|..|.+. +.|.+|..+|+ +-.|.|+.
T Consensus 264 ykCplCdmtc~~~ssL~~H~r~rHs----------------~dkpfKCd~Cd~~c~~esdL~kH~~~HS-~~~y~C~h~~ 326 (467)
T KOG3608|consen 264 YKCPLCDMTCSSASSLTTHIRYRHS----------------KDKPFKCDECDTRCVRESDLAKHVQVHS-KTVYQCEHPD 326 (467)
T ss_pred ccccccccCCCChHHHHHHHHhhhc----------------cCCCccccchhhhhccHHHHHHHHHhcc-ccceecCCCC
Confidence 8899999999999999999988897 5788888888744 47999999999 67899988
Q ss_pred cCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccccCC------CCccCCCCCCcCCCh
Q 000417 990 CGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGL------GAVSYRIRNRGAAGM 1059 (1534)
Q Consensus 990 CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~ge------kpy~C~iCgksFs~~ 1059 (1534)
|..+|++...|++|.+.+|.|.+ .-+|.|..|++.|++..+|.+|++..++. +.|..+.|.-+|.++
T Consensus 327 C~~s~r~~~q~~~H~~evhEg~n---p~~Y~CH~Cdr~ft~G~~L~~HL~kkH~f~~PsGh~RFtYk~~edG~mRL 399 (467)
T KOG3608|consen 327 CHYSVRTYTQMRRHFLEVHEGNN---PILYACHCCDRFFTSGKSLSAHLMKKHGFRLPSGHKRFTYKVDEDGFMRL 399 (467)
T ss_pred CcHHHHHHHHHHHHHHHhccCCC---CCceeeecchhhhccchhHHHHHHHhhcccCCCCCCceeeeeccCceeee
Confidence 99999999999998788887733 56899999999999999999999666554 457778888877543
No 14
>PF05033 Pre-SET: Pre-SET motif; InterPro: IPR007728 This region is found in a number of histone lysine methyltransferases (HMTase), N-terminal to the SET domain; it is generally described as the pre-SET domain. Histone lysine methylation is part of the histone code that regulated chromatin function and epigenetic control of gene function. Histone lysine methyltransferases (HMTase) differ both in their substrate specificity for the various acceptor lysines as well as in their product specificity for the number of methyl groups (one, two, or three) they transfer. With just one exception [], the HMTases belong to SET family that can be classified according to the sequences surrounding the SET domain [, ]. Structural studies on the human SET7/9, a mono-methylase, have revealed the molecular basis for the specificity of the enzyme for the histone-target and the roles of the invariant residues in the SET domain in determining the methylation specificities []. The pre-SET domain, as found in the SUV39 SET family, contains nine invariant cysteine residues that are grouped into two segments separated by a region of variable length. These 9 cysteines coordinate 3 zinc ions to form a triangular cluster, where each of the zinc ions is coordinated by 4 four cysteines to give a tetrahedral configuration. The function of this domain is structural, holding together 2 long segments of random coils and stabilising the SET domain. The C-terminal region including the post-SET domain is disordered when not interacting with a histone tail and in the absence of zinc. The three conserved cysteines in the post-SET domain form a zinc-binding site [] when coupled to a fourth conserved cysteine in the knot-like structure close to the SET domain active site []. The structured post-SET region brings in the C-terminal residues that participate in S-adenosylmethine-binding and histone tail interactions. The three conserved cysteine residues are essential for HMTase activity, as replacement with serine abolishes HMTase activity []. ; GO: 0008270 zinc ion binding, 0018024 histone-lysine N-methyltransferase activity, 0034968 histone lysine methylation, 0005634 nucleus; PDB: 3K5K_A 2O8J_D 3RJW_B 1ML9_A 1PEG_B 1MVH_A 1MVX_A 3BO5_A 2RFI_B 3MO5_B ....
Probab=99.66 E-value=1.3e-16 Score=157.77 Aligned_cols=102 Identities=32% Similarity=0.664 Sum_probs=69.2
Q ss_pred cCCCCCCCCCeeEeeCCCCcccccccCCCCCcccccCCCCCCCcEEeccCCCCCCCCCcccCCCCCcccCCCCc-CCCCC
Q 000417 1236 DISSGLESVPVACVVDDGLLETLCISADSSDSQKTRCSMPWESFTYVTKPLLDQSLDLDAESLQLGCACANSTC-FPETC 1314 (1534)
Q Consensus 1236 DIS~G~E~vPV~~vnd~D~~~~~~~~g~~~~~~~~~~~~P~~~F~Yi~~~~~~~~~~~d~e~~~~GC~C~~~~C-~p~~C 1314 (1534)
|||.|+|++||+++|++|+. .||..|+||+++++..++......+..||+|.+ .| .+.+|
T Consensus 1 Dis~g~e~~pI~~~N~vd~~------------------~~p~~F~Yi~~~~~~~~~~~~~~~~~~~C~C~~-~C~~~~~C 61 (103)
T PF05033_consen 1 DISRGKENVPIPVVNDVDDE------------------PPPPNFEYIPENIYGEGVPDIDPEFLQGCDCSG-DCSNPSNC 61 (103)
T ss_dssp -TTCTSSSS-EEEEESSSS--------------------SSTSSEE-SS-EESTTSS-TBGGGTS----SS-SSTCTTTS
T ss_pred CCCCCccCCCEEEEeCCCCC------------------CCCCCeEEeeeEEcCCCccccccccCccCccCC-CCCCCCCC
Confidence 89999999999999999963 234799999999998876523345678999975 57 67889
Q ss_pred CcccccccccccccccCCCCcCCCcccCCCCceeecCCceEEecCCCCCCCCCCCCc
Q 000417 1315 DHVYLFDNDYEDAKDIDGKSVHGRFPYDQTGRVILEEGYLIYECNHMCSCDRTCPNR 1371 (1534)
Q Consensus 1315 ~C~~l~~~~y~~~~~i~g~~~~g~~~Yd~~G~l~~~~~~~IyECn~~C~C~~~C~NR 1371 (1534)
.|+..+ ++.++|+.+|+|......+|||||+.|+|+.+|+||
T Consensus 62 ~C~~~~---------------~~~~~Y~~~g~l~~~~~~~i~EC~~~C~C~~~C~NR 103 (103)
T PF05033_consen 62 ECLQRN---------------GGIFAYDSNGRLRIPDKPPIFECNDNCGCSPSCRNR 103 (103)
T ss_dssp HHHCCT---------------SSS-SB-TTSSBSSSSTSEEE---TTSSS-TTSTT-
T ss_pred cCcccc---------------CccccccCCCcCccCCCCeEEeCCCCCCCCCCCCCC
Confidence 997532 234689999998877889999999999999999998
No 15
>KOG3623 consensus Homeobox transcription factor SIP1 [Transcription]
Probab=99.66 E-value=2.2e-17 Score=198.28 Aligned_cols=80 Identities=21% Similarity=0.246 Sum_probs=76.3
Q ss_pred eeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccccCCCCccCCCCCCcCCChHHHH
Q 000417 984 KFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRIRNRGAAGMKKRI 1063 (1534)
Q Consensus 984 pykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~iCgksFs~~~~L~ 1063 (1534)
.|.|+.|+|.|...+.|.+ |+--|+| .|||+|.+|.|+|+.+..|..|+|.|.|+|||.|+.|+|.|+...+..
T Consensus 894 myaCDqCDK~FqKqSSLaR-HKYEHsG-----qRPyqC~iCkKAFKHKHHLtEHkRLHSGEKPfQCdKClKRFSHSGSYS 967 (1007)
T KOG3623|consen 894 MYACDQCDKAFQKQSSLAR-HKYEHSG-----QRPYQCIICKKAFKHKHHLTEHKRLHSGEKPFQCDKCLKRFSHSGSYS 967 (1007)
T ss_pred cchHHHHHHHHHhhHHHHH-hhhhhcC-----CCCcccchhhHhhhhhhhhhhhhhhccCCCcchhhhhhhhcccccchH
Confidence 3899999999999999999 8999999 999999999999999999999999999999999999999999988888
Q ss_pred hhccccC
Q 000417 1064 QTLKPLA 1070 (1534)
Q Consensus 1064 kH~KsH~ 1070 (1534)
+||. |.
T Consensus 968 QHMN-HR 973 (1007)
T KOG3623|consen 968 QHMN-HR 973 (1007)
T ss_pred hhhc-cc
Confidence 8887 64
No 16
>KOG1074 consensus Transcriptional repressor SALM [Transcription]
Probab=99.66 E-value=4.2e-17 Score=199.52 Aligned_cols=240 Identities=21% Similarity=0.232 Sum_probs=161.8
Q ss_pred CcccCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhccccccccc------ccccccc
Q 000417 846 KTHKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVEQ------CMLQQCI 919 (1534)
Q Consensus 846 kpykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~------~kpykC~ 919 (1534)
-+++|.+|.|.|.+.+.|+.| .+.|+++ +||+|.+||..|.++.+|+.|...|+..-+..+ ...++|.
T Consensus 352 ~khkCr~CakvfgS~SaLqiH-lRSHTGE-----RPfqCnvCG~~FSTkGNLKvH~~rH~e~~p~~~m~p~~~~e~l~~~ 425 (958)
T KOG1074|consen 352 FKHKCRFCAKVFGSDSALQIH-LRSHTGE-----RPFQCNVCGNRFSTKGNLKVHFQRHREKYPHVQMNPHPVQEHLQYV 425 (958)
T ss_pred ccchhhhhHhhcCchhhhhhh-hhccCCC-----CCeeecccccccccccceeeeeeeccccCCccccCCCCchhhhcce
Confidence 357899999999999999999 8999999 999999999999999999999988876532221 1235666
Q ss_pred cCCCccCChHHHhhhhhccccCc-------------ccch------hh--------hhhcccc-----------------
Q 000417 920 PCGSHFGNTEELWLHVQSVHAID-------------FKMS------EV--------AQQHNQS----------------- 955 (1534)
Q Consensus 920 ~CgK~Fssk~~Lk~H~~rvH~~e-------------f~C~------~C--------~k~f~~~----------------- 955 (1534)
+|.-.|.+-....-|-...|... -.++ .+ ...|...
T Consensus 426 i~st~~p~g~~vpp~k~~~~~~~~e~~~~~~sts~g~~~~~~~~~sv~~~~ts~~~~~~~s~~~~~~~~~i~~~s~e~e~ 505 (958)
T KOG1074|consen 426 ITSTGLPYGPSVPPEKAEEEAATVEPKLLVRSTSVGSATESLTPSSVSFGETSAPPLPAFSKFVLMKTVEIKSKSEEPEP 505 (958)
T ss_pred eeccccCCCCCCCCCCCcchhccccccccccccccCCCCCcccccccccccccCCCCCccccccccCCcccccccCCCCc
Confidence 66666655444444421111100 0000 00 0000000
Q ss_pred ------------------------------------------cCCCCCccccCCCch-hhhhhhh-----hc--------
Q 000417 956 ------------------------------------------VGEDSPKKLELGYSA-SVENHSE-----NL-------- 979 (1534)
Q Consensus 956 ------------------------------------------~geKp~~C~~Cgk~~-sLk~Hlr-----tH-------- 979 (1534)
.....|.+...+-.- .+.+-+. -+
T Consensus 506 ~vs~g~~~~~~~~gs~l~~s~~ks~~s~~~~~~~~~~~asa~m~~~~~~~~p~g~s~~~~aq~~~l~d~~~~~~~~~~ts 585 (958)
T KOG1074|consen 506 AVSEGSAISGVLEGSPLRMSSGKSVESLPVEADLLNHAASAGMFPPSYVSRPLGPSEDTTAQALQLVDKIPEALIEISTS 585 (958)
T ss_pred cccccccccccccCCccccccccCccccchhccccchhhccccCCchhhcCCCCcchhhHHHhhhhhccChhhcceeecc
Confidence 001111122111000 0111110 00
Q ss_pred ---------------CCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccccCC
Q 000417 980 ---------------GSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGL 1044 (1534)
Q Consensus 980 ---------------tgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~ge 1044 (1534)
....|-+|-+|-++..-++.|+. |.|+|+| +|||+|.+|+++|.++.+|+.||-+|...
T Consensus 586 seS~kl~slv~~~~~~~TdPNqCiiC~rVlSC~saLqm-HyrtHtG-----ERPFkCKiCgRAFtTkGNLkaH~~vHka~ 659 (958)
T KOG1074|consen 586 SESPKLTSLVENSENKRTDPNQCIICLRVLSCPSALQM-HYRTHTG-----ERPFKCKICGRAFTTKGNLKAHMSVHKAK 659 (958)
T ss_pred cCCccccccccccccccCCccceeeeeecccchhhhhh-hhhcccC-----cCccccccccchhccccchhhcccccccC
Confidence 00146799999999999999999 8999999 99999999999999999999999999876
Q ss_pred C----CccCC---CCCCcCCChHHHHhhccccCCCCcccCCCcccccccCccccccchhhhhhh
Q 000417 1045 G----AVSYR---IRNRGAAGMKKRIQTLKPLASGEIVEQPKATEVVTLGTLVESQCSTLSRIL 1101 (1534)
Q Consensus 1045 k----py~C~---iCgksFs~~~~L~kH~KsH~~~~~tsqp~~sEt~~s~~L~~~qCs~v~k~L 1101 (1534)
- .++|+ +|.+.|.+...|.+|.++|..+....-... ..+.+...||+.+.+.+
T Consensus 660 p~~R~q~ScP~~~ic~~kftn~V~lpQhIriH~~~~~s~g~~a----~e~~~~adq~~~~qk~~ 719 (958)
T KOG1074|consen 660 PPARVQFSCPSTFICQKKFTNAVTLPQHIRIHLGGQISNGGTA----AEGILAADQCSSCQKTF 719 (958)
T ss_pred ccccccccCCchhhhcccccccccccceEEeecCCCCCCCccc----ccccchhcccchhhhcc
Confidence 3 48999 999999999999999999864433222111 24556777888777765
No 17
>smart00468 PreSET N-terminal to some SET domains. A Cys-rich putative Zn2+-binding domain that occurs N-terminal to some SET domains. Function is unknown. Unpublished.
Probab=99.60 E-value=1.4e-15 Score=149.29 Aligned_cols=96 Identities=34% Similarity=0.652 Sum_probs=78.5
Q ss_pred eecCCCCCCCCCeeEeeCCCCcccccccCCCCCcccccCCCCCCCcEEeccCCCCCCCCC-cccCCCCCcccCCCCcCCC
Q 000417 1234 CDDISSGLESVPVACVVDDGLLETLCISADSSDSQKTRCSMPWESFTYVTKPLLDQSLDL-DAESLQLGCACANSTCFPE 1312 (1534)
Q Consensus 1234 ~~DIS~G~E~vPV~~vnd~D~~~~~~~~g~~~~~~~~~~~~P~~~F~Yi~~~~~~~~~~~-d~e~~~~GC~C~~~~C~p~ 1312 (1534)
+.|||+|+|++||++||++|+. .|+.+|+||++++++.++.+ ....+..||+|.+ .|++.
T Consensus 1 ~~Dis~G~E~~pI~~vN~vD~~------------------~~p~~F~Yi~~~~~~~gv~~~~~~~~~~gC~C~~-~C~~~ 61 (98)
T smart00468 1 CLDISNGKENVPVPLVNEVDED------------------PPPPDFEYISEYIYGQGVPIDRSPSPLVGCSCSG-DCSSS 61 (98)
T ss_pred CccccCCccCCCcceEecCCCC------------------CCCCCcEECcceEcCCCcccccCCCCCCCCcCCC-CCCCC
Confidence 3699999999999999999963 23379999999999888753 3466789999997 78887
Q ss_pred C-CCcccccccccccccccCCCCcCCCcccCCCCceeecCCceEEecCCCCC
Q 000417 1313 T-CDHVYLFDNDYEDAKDIDGKSVHGRFPYDQTGRVILEEGYLIYECNHMCS 1363 (1534)
Q Consensus 1313 ~-C~C~~l~~~~y~~~~~i~g~~~~g~~~Yd~~G~l~~~~~~~IyECn~~C~ 1363 (1534)
. |.|+.+ .++.|+|+..+++++..+.+|||||+.|+
T Consensus 62 ~~C~C~~~---------------~~~~~~Y~~~~~~~~~~~~~IyECn~~C~ 98 (98)
T smart00468 62 NKCECARK---------------NGGEFAYELNGGLRLKRKPLIYECNSRCS 98 (98)
T ss_pred CcCCcHhh---------------cCCccCcccCCCEEeCCCCEEEcCCCCCC
Confidence 6 999643 24678997777778888999999999985
No 18
>COG2940 Proteins containing SET domain [General function prediction only]
Probab=99.55 E-value=1e-15 Score=188.98 Aligned_cols=164 Identities=33% Similarity=0.476 Sum_probs=132.7
Q ss_pred EEecCCCCCCCCCCCCcccccCceeeEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhccccCCCcceEE
Q 000417 1355 IYECNHMCSCDRTCPNRVLQNGVRVKLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRSRYGRDGCGYML 1434 (1534)
Q Consensus 1355 IyECn~~C~C~~~C~NRvvQ~g~~~~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~~y~~~~~sYlf 1434 (1534)
+.+++..+.....+.|............+..+..+||||||.+.|++|++|.+|.|+++...++..+...+...+..+.|
T Consensus 308 ~~~~~s~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~g~fa~~~i~~~e~i~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 387 (480)
T COG2940 308 SDFSKSNVSKLKELLNSNGCKKRREPNVVQESEIKGYGVFALESIKKGEFIIEYHGEIIRRKEAREREENYDLLGNEFSF 387 (480)
T ss_pred cccccccCccccchhhhcccccccchhhhhhhcccccceeehhhccchHHHHHhcCcccchHHHHhhhccccccccccch
Confidence 33445555555567777777777888888899999999999999999999999999999999998888766444433333
Q ss_pred ecCcccccccccccCceeEEEeccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCC
Q 000417 1435 NIGAHINDMGRLIEGQVRYVIDATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYEL 1514 (1534)
Q Consensus 1435 ~ld~~~~d~~~l~~~~~~~~IDA~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~ 1514 (1534)
.... ....++|+...|+++|||||||.||+.+....+. +..++.++|+|||.+|||||+||+..+
T Consensus 388 ~~~~-----------~~~~~~d~~~~g~~~r~~nHS~~pN~~~~~~~~~----g~~~~~~~~~rDI~~geEl~~dy~~~~ 452 (480)
T COG2940 388 GLLE-----------DKDKVRDSQKAGDVARFINHSCTPNCEASPIEVN----GIFKISIYAIRDIKAGEELTYDYGPSL 452 (480)
T ss_pred hhcc-----------ccchhhhhhhcccccceeecCCCCCcceeccccc----ccceeeecccccchhhhhhcccccccc
Confidence 3222 1267899999999999999999999999877665 367899999999999999999999887
Q ss_pred CCCC--------CceeeCCCCCCcccc
Q 000417 1515 LSGE--------GYPCHCGASKCRGRL 1533 (1534)
Q Consensus 1515 ~~~~--------~~~C~CGS~~CRG~l 1533 (1534)
+... ...|.||+..|+++|
T Consensus 453 ~~~~~~~~~~~~~~~~~~~~~~~~~~~ 479 (480)
T COG2940 453 EDNRELKKLLEKRWGCACGEDRCSHTM 479 (480)
T ss_pred ccchhhhhhhhhhhccccCCCccCCCC
Confidence 6422 578999999999987
No 19
>KOG3576 consensus Ovo and related transcription factors [Transcription]
Probab=99.31 E-value=3.2e-13 Score=143.50 Aligned_cols=85 Identities=24% Similarity=0.489 Sum_probs=51.3
Q ss_pred CCCcccCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcccccccccccccccccCCC
Q 000417 844 DEKTHKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGS 923 (1534)
Q Consensus 844 gekpykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK 923 (1534)
+...|.|.+|+|.|....-|.+| ++.|... +.|-|..|||.|...-.|++|+++|++. +||+|..|+|
T Consensus 114 d~d~ftCrvCgK~F~lQRmlnrh-~kch~~v-----kr~lct~cgkgfndtfdlkrh~rthtgv------rpykc~~c~k 181 (267)
T KOG3576|consen 114 DQDSFTCRVCGKKFGLQRMLNRH-LKCHSDV-----KRHLCTFCGKGFNDTFDLKRHTRTHTGV------RPYKCSLCEK 181 (267)
T ss_pred CCCeeeeehhhhhhhHHHHHHHH-hhhccHH-----HHHHHhhccCcccchhhhhhhhccccCc------cccchhhhhH
Confidence 34456666666666666666666 5566555 5566666666666666666666666655 5556666666
Q ss_pred ccCChHHHhhhhhcccc
Q 000417 924 HFGNTEELWLHVQSVHA 940 (1534)
Q Consensus 924 ~Fssk~~Lk~H~~rvH~ 940 (1534)
.|+.+..|..|.+++|.
T Consensus 182 aftqrcsleshl~kvhg 198 (267)
T KOG3576|consen 182 AFTQRCSLESHLKKVHG 198 (267)
T ss_pred HHHhhccHHHHHHHHcC
Confidence 66666666666555553
No 20
>PF00856 SET: SET domain; InterPro: IPR001214 The SET domain appears generally as one part of a larger multidomain protein, and recently there were described three structures of very different proteins with distinct domain compositions: Neurospora crassa DIM-5, a member of the Su(var) family of HKMTs which methylate histone H3 on lysine 9,human SET7 (also called SET9), which methylates H3 on lysine 4 and garden pea Rubisco LSMT, an enzyme that does not modify histones, but instead methylates lysine 14 in the flexible tail of the large subunit of the enzyme Rubisco. The SET domain itself turned out to be an uncommon structure. Although in all three studies, electron density maps revealed the location of the AdoMet or AdoHcy cofactor, the SET domain bears no similarity at all to the canonical/AdoMet-dependent methyltransferase fold. Strictly conserved in the C-terminal motif of the SET domain tyrosine could be involved in abstracting a proton from the protonated amino group of the substrate lysine, promoting its nucleophilic attack on the sulphonium methyl group of the AdoMet cofactor. In contrast to the AdoMet-dependent protein methyltranferases of the classical type, which tend to bind their polypeptide substrates on top of the cofactor, it is noted from the Rubisco LSMT structure that the AdoMet seems to bind in a separate cleft, suggesting how a polypeptide substrate could be subjected to multiple rounds of methylation without having to be released from the enzyme. In contrast, SET7/9 is able to add only a single methyl group to its substrate. It has been demonstrated that association of SET domain and myotubularin-related proteins modulates growth control []. The SET domain-containing Drosophila melanogaster (Fruit fly) protein, enhancer of zeste, has a function in segment determination and the mammalian homologue may be involved in the regulation of gene transcription and chromatin structure. Histone lysine methylation is part of the histone code that regulated chromatin function and epigenetic control of gene function. Histone lysine methyltransferases (HMTase) differ both in their substrate specificity for the various acceptor lysines as well as in their product specificity for the number of methyl groups (one, two, or three) they transfer. With just one exception [], the HMTases belong to SET family that can be classified according to the sequences surrounding the SET domain [, ]. Structural studies on the human SET7/9, a mono-methylase, have revealed the molecular basis for the specificity of the enzyme for the histone-target and the roles of the invariant residues in the SET domain in determining the methylation specificities []. The pre-SET domain, as found in the SUV39 SET family, contains nine invariant cysteine residues that are grouped into two segments separated by a region of variable length. These 9 cysteines coordinate 3 zinc ions to form to form a triangular cluster, where each of the zinc ions is coordinated by 4 four cysteines to give a tetrahedral configuration. The function of this domain is structural, holding together 2 long segments of random coils. The C-terminal region including the post-SET domain is disordered when not interacting with a histone tail and in the absence of zinc. The three conserved cysteines in the post-SET domain form a zinc-binding site when coupled to a fourth conserved cysteine in the knot-like structure close to the SET domain active site []. The structured post-SET region brings in the C-terminal residues that participate in S-adenosylmethine-binding and histone tail interactions. The three conserved cysteine residues are essential for HMTase activity, as replacement with serine abolishes HMTase activity [], []. ; GO: 0005515 protein binding; PDB: 3TG5_A 3S7F_A 3RIB_B 3TG4_A 3S7J_A 3S7D_A 3S7B_A 3H6L_A 3SMT_A 3K5K_A ....
Probab=99.29 E-value=1.8e-12 Score=133.61 Aligned_cols=118 Identities=18% Similarity=0.087 Sum_probs=73.6
Q ss_pred CccccccccccCCCeEEEeeeEeecHHHHHHHh---ccc--cCCCcceE--E----------------------------
Q 000417 1390 GWAVRAGQAILRGTFVCEYIGEVLDELETNKRR---SRY--GRDGCGYM--L---------------------------- 1434 (1534)
Q Consensus 1390 GwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~---~~y--~~~~~sYl--f---------------------------- 1434 (1534)
|+||+|+++|++|++|+++.+.+++...+.... ... ........ +
T Consensus 1 GrGl~At~dI~~Ge~I~~p~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 80 (162)
T PF00856_consen 1 GRGLFATRDIKAGEVILIPRPAILTPDEVSPQPELLRLQLSKALEEQSRSDFSIQKKQKAEKSERSPQLESLHSISLRSE 80 (162)
T ss_dssp SEEEEESS-B-TTEEEEEESEEEEEHHHHHCHHHHSHHTTCSSSCSHHTTHHHHHHHHHHHHHHHHHHHHHHHHHCHTTT
T ss_pred CEEEEECccCCCCCEEEEECcceEEehhhhhcccchhhhhhhhhcccccccccccccccccccccccccccccccccccc
Confidence 899999999999999999999999987775420 000 00000000 0
Q ss_pred -ecCcc-c--c-----cccccccCceeEEEeccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCe
Q 000417 1435 -NIGAH-I--N-----DMGRLIEGQVRYVIDATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEE 1505 (1534)
Q Consensus 1435 -~ld~~-~--~-----d~~~l~~~~~~~~IDA~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEE 1505 (1534)
..... . . ..............++.....++.||||||.|||.+...... ....+.|.|.|||++|||
T Consensus 81 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~p~~d~~NHsc~pn~~~~~~~~~----~~~~~~~~a~r~I~~GeE 156 (162)
T PF00856_consen 81 LQFSQAFQWSWFISWTRSDFSSRSFSEDDRDGIALYPFADMLNHSCDPNCEVSFDFDG----DGGCLVVRATRDIKKGEE 156 (162)
T ss_dssp CCTCCHHHHHHHHHHHHHEEEEEEETTEEEEEEEEETGGGGSEEESSTSEEEEEEEET----TTTEEEEEESS-B-TTSB
T ss_pred ccccccccchhhccccceeeeccccccccccccccCcHhHheccccccccceeeEeec----ccceEEEEECCccCCCCE
Confidence 00000 0 0 000000011224456677788999999999999998776543 567899999999999999
Q ss_pred EEEEcC
Q 000417 1506 LTYDYH 1511 (1534)
Q Consensus 1506 LT~DYg 1511 (1534)
||++||
T Consensus 157 i~isYG 162 (162)
T PF00856_consen 157 IFISYG 162 (162)
T ss_dssp EEEEST
T ss_pred EEEEEC
Confidence 999998
No 21
>KOG3576 consensus Ovo and related transcription factors [Transcription]
Probab=99.28 E-value=1.7e-12 Score=138.04 Aligned_cols=121 Identities=17% Similarity=0.304 Sum_probs=106.9
Q ss_pred CccccCccCcccCChHHHHhHhhhcccccccccccccccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCC
Q 000417 880 RGYACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGED 959 (1534)
Q Consensus 880 kpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geK 959 (1534)
..|.|.+|+|.|.-...|.+|++.|... +.|-|..|||.|.....|++|
T Consensus 116 d~ftCrvCgK~F~lQRmlnrh~kch~~v------kr~lct~cgkgfndtfdlkrh------------------------- 164 (267)
T KOG3576|consen 116 DSFTCRVCGKKFGLQRMLNRHLKCHSDV------KRHLCTFCGKGFNDTFDLKRH------------------------- 164 (267)
T ss_pred CeeeeehhhhhhhHHHHHHHHhhhccHH------HHHHHhhccCcccchhhhhhh-------------------------
Confidence 5699999999999999999999999887 667899999999998888777
Q ss_pred CCccccCCCchhhhhhhhhcCCcceeeecccCCccCChhHHHHHHHhhccCCCC-----CCCCCcccCCCCcccCCchhh
Q 000417 960 SPKKLELGYSASVENHSENLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNL-----VNSRPHKKGIRFYAYKLKSGR 1034 (1534)
Q Consensus 960 p~~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~-----~~eKpYkC~iC~K~F~sks~L 1034 (1534)
+|+|+|.+||+|..|+|+|.++-.|..|..++|.-... ...|.|.|+.||++-.....+
T Consensus 165 ----------------~rthtgvrpykc~~c~kaftqrcsleshl~kvhgv~~~yaykerr~kl~vcedcg~t~~~~e~~ 228 (267)
T KOG3576|consen 165 ----------------TRTHTGVRPYKCSLCEKAFTQRCSLESHLKKVHGVQHQYAYKERRAKLYVCEDCGYTSERPEVY 228 (267)
T ss_pred ----------------hccccCccccchhhhhHHHHhhccHHHHHHHHcCchHHHHHHHhhhheeeecccCCCCCChhHH
Confidence 56788999999999999999999999988899976432 226789999999999999999
Q ss_pred hcccccccCCCCc
Q 000417 1035 LSRPRFKKGLGAV 1047 (1534)
Q Consensus 1035 ~rH~r~H~gekpy 1047 (1534)
..|++.|+...|+
T Consensus 229 ~~h~~~~hp~Spa 241 (267)
T KOG3576|consen 229 YLHLKLHHPFSPA 241 (267)
T ss_pred HHHHHhcCCCCHH
Confidence 9999999887553
No 22
>KOG3623 consensus Homeobox transcription factor SIP1 [Transcription]
Probab=99.18 E-value=5.4e-12 Score=152.73 Aligned_cols=125 Identities=22% Similarity=0.347 Sum_probs=85.4
Q ss_pred cccCccCcccCChHHHHhHhhhcccccccccccccccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCCCC
Q 000417 882 YACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSP 961 (1534)
Q Consensus 882 ykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~ 961 (1534)
..|++|.+.+..-..|+.|++..|...+ -.|.|..|..+|..+..|.+| +..|... +..
T Consensus 211 ltcpycdrgykrltslkeHikyrhekne----~nfsC~lCsytFAyRtQLErh-m~~hkpg------~dq---------- 269 (1007)
T KOG3623|consen 211 LTCPYCDRGYKRLTSLKEHIKYRHEKNE----PNFSCMLCSYTFAYRTQLERH-MQLHKPG------GDQ---------- 269 (1007)
T ss_pred hcchhHHHHHHHHHHHHHHHHHHHhhCC----CCCcchhhhhhhhhHHHHHHH-HHhhcCC------Ccc----------
Confidence 4566666666666666666655444322 235566666666666666666 4455310 000
Q ss_pred ccccCCCchhhhhhhhhcCCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccc
Q 000417 962 KKLELGYSASVENHSENLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFK 1041 (1534)
Q Consensus 962 ~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H 1041 (1534)
..|+-.-...+.|+|..|||.|+.+.+|+. |.|+|.| +|||.|+-|+|+|+...++..||...
T Consensus 270 -----------a~sltqsa~lRKFKCtECgKAFKfKHHLKE-HlRIHSG-----EKPfeCpnCkKRFSHSGSySSHmSSK 332 (1007)
T KOG3623|consen 270 -----------AISLTQSALLRKFKCTECGKAFKFKHHLKE-HLRIHSG-----EKPFECPNCKKRFSHSGSYSSHMSSK 332 (1007)
T ss_pred -----------cccccchhhhccccccccchhhhhHHHHHh-hheeecC-----CCCcCCcccccccccCCccccccccc
Confidence 011111223478999999999999999999 8999999 99999999999999999999999666
Q ss_pred cCC
Q 000417 1042 KGL 1044 (1534)
Q Consensus 1042 ~ge 1044 (1534)
+..
T Consensus 333 KCI 335 (1007)
T KOG3623|consen 333 KCI 335 (1007)
T ss_pred chh
Confidence 543
No 23
>PLN03086 PRLI-interacting factor K; Provisional
Probab=98.76 E-value=6.3e-09 Score=128.72 Aligned_cols=139 Identities=17% Similarity=0.163 Sum_probs=102.3
Q ss_pred cccCccCcccCChHHHHhHhhhccccccccccccccccc--CCCccCChHHHhhhhhccccCcccchhhhhhcccccCCC
Q 000417 882 YACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIP--CGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGED 959 (1534)
Q Consensus 882 ykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~--CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geK 959 (1534)
-.|+.|..... ...|..|...... ..-.|+. |+..| .+..+..|
T Consensus 408 V~C~NC~~~i~-l~~l~lHe~~C~r-------~~V~Cp~~~Cg~v~-~r~el~~H------------------------- 453 (567)
T PLN03086 408 VECRNCKHYIP-SRSIALHEAYCSR-------HNVVCPHDGCGIVL-RVEEAKNH------------------------- 453 (567)
T ss_pred EECCCCCCccc-hhHHHHHHhhCCC-------cceeCCccccccee-eccccccC-------------------------
Confidence 46999987655 4556677643222 1234874 88888 34455555
Q ss_pred CCccccCCCch---hhhhhhhhcCCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCC------
Q 000417 960 SPKKLELGYSA---SVENHSENLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKL------ 1030 (1534)
Q Consensus 960 p~~C~~Cgk~~---sLk~HlrtHtgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~s------ 1030 (1534)
+.|..|+..+ .|..|+++|+ +++.|+ ||+.| .+..|.. |+++|.. .+++.|.+|++.|..
T Consensus 454 -~~C~~Cgk~f~~s~LekH~~~~H--kpv~Cp-Cg~~~-~R~~L~~-H~~thCp-----~Kpi~C~fC~~~v~~g~~~~d 522 (567)
T PLN03086 454 -VHCEKCGQAFQQGEMEKHMKVFH--EPLQCP-CGVVL-EKEQMVQ-HQASTCP-----LRLITCRFCGDMVQAGGSAMD 522 (567)
T ss_pred -ccCCCCCCccchHHHHHHHHhcC--CCccCC-CCCCc-chhHHHh-hhhccCC-----CCceeCCCCCCccccCccccc
Confidence 3455555333 5899999985 899999 99765 6789998 7899999 899999999999952
Q ss_pred ----chhhhcccccccCCCCccCCCCCCcCCChHHHHhhcc
Q 000417 1031 ----KSGRLSRPRFKKGLGAVSYRIRNRGAAGMKKRIQTLK 1067 (1534)
Q Consensus 1031 ----ks~L~rH~r~H~gekpy~C~iCgksFs~~~~L~kH~K 1067 (1534)
.+.|..|..++ |.+++.|..||+.+. ++.+..|+.
T Consensus 523 ~~d~~s~Lt~HE~~C-G~rt~~C~~Cgk~Vr-lrdm~~H~~ 561 (567)
T PLN03086 523 VRDRLRGMSEHESIC-GSRTAPCDSCGRSVM-LKEMDIHQI 561 (567)
T ss_pred hhhhhhhHHHHHHhc-CCcceEccccCCeee-ehhHHHHHH
Confidence 45899999886 999999999998875 445556654
No 24
>KOG1081 consensus Transcription factor NSD1 and related SET domain proteins [Transcription]
Probab=98.70 E-value=4.5e-09 Score=128.97 Aligned_cols=145 Identities=35% Similarity=0.609 Sum_probs=108.4
Q ss_pred EEec-CCCCCCCCCCCCcccccCceeeEEEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhccccCCC--cc
Q 000417 1355 IYEC-NHMCSCDRTCPNRVLQNGVRVKLEVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRSRYGRDG--CG 1431 (1534)
Q Consensus 1355 IyEC-n~~C~C~~~C~NRvvQ~g~~~~LeVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~~y~~~~--~s 1431 (1534)
.+|| +..|.+...|.|+-........ +.. +|..+|.+| +|++++..+...|........ ..
T Consensus 289 ~~~~~p~~~~~~~~~~~~~~sk~~~~e------~~~----~~~~~~~k~------vg~~i~~~e~~~~~~~~~~~~~~~~ 352 (463)
T KOG1081|consen 289 AYEVHPKVCSAEERCHNQQFSKESYPE------PQK----TAKADIRKG------VGEVIDDKECKARLQRVKESDLVDF 352 (463)
T ss_pred hhhhcccccccccccccchhhhhcccc------cch----hhHHhhhcc------cCcccchhhheeehhhhhccchhhh
Confidence 3444 5788888889888654433333 222 899999999 999999988776553322211 11
Q ss_pred eEEecCcccccccccccCceeEEEeccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcC
Q 000417 1432 YMLNIGAHINDMGRLIEGQVRYVIDATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYH 1511 (1534)
Q Consensus 1432 Ylf~ld~~~~d~~~l~~~~~~~~IDA~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg 1511 (1534)
|+..+.. ...||+..+||.+||+||||+||+..+.+.+. +..++++||.++|++||||||+|.
T Consensus 353 ~~~~~e~-------------~~~id~~~~~n~sr~~nh~~~~~v~~~k~~~~----~~t~~~~~a~~~i~~g~e~t~~~n 415 (463)
T KOG1081|consen 353 YMVFIQK-------------DRIIDAGPKGNYSRFLNHSCQPNVETEKWQVI----GDTRVGLFAPRQIEAGEELTFNYN 415 (463)
T ss_pred hhhhhhc-------------ccccccccccchhhhhcccCCCceeechhhee----cccccccccccccccchhhhheee
Confidence 2111111 22899999999999999999999999888777 778899999999999999999998
Q ss_pred CCCCCCCCceeeCCCCCCcccc
Q 000417 1512 YELLSGEGYPCHCGASKCRGRL 1533 (1534)
Q Consensus 1512 ~~~~~~~~~~C~CGS~~CRG~l 1533 (1534)
..-. +....|.||+.+|.+.+
T Consensus 416 ~~~~-~~~~~~~~~~e~~~~~~ 436 (463)
T KOG1081|consen 416 GNCE-GNEKRCCCGSENCTETK 436 (463)
T ss_pred cccc-CCcceEeecccccccCC
Confidence 7642 34689999999998864
No 25
>PLN03086 PRLI-interacting factor K; Provisional
Probab=98.69 E-value=1.3e-08 Score=126.12 Aligned_cols=143 Identities=20% Similarity=0.325 Sum_probs=100.6
Q ss_pred CcccCCCCCcccCChhhHhhhhhcccCccccccCCccccCc--cCcccCChHHHHhHhhhcccccccccccccccccCCC
Q 000417 846 KTHKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAI--CLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGS 923 (1534)
Q Consensus 846 kpykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~--CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK 923 (1534)
..-.|+.|...... ..|..| .... .. ..-.|+. |+..|. +..+..| +.|+.|++
T Consensus 406 ~~V~C~NC~~~i~l-~~l~lH-e~~C-~r-----~~V~Cp~~~Cg~v~~-r~el~~H---------------~~C~~Cgk 461 (567)
T PLN03086 406 DTVECRNCKHYIPS-RSIALH-EAYC-SR-----HNVVCPHDGCGIVLR-VEEAKNH---------------VHCEKCGQ 461 (567)
T ss_pred CeEECCCCCCccch-hHHHHH-HhhC-CC-----cceeCCcccccceee-ccccccC---------------ccCCCCCC
Confidence 34579999887765 456688 3332 22 3456885 999883 4445555 24999999
Q ss_pred ccCChHHHhhhhhccccCcccchhhhhhcccccCCCCCccccCCCchhhhhhhhhcCCcceeeecccCCccC--------
Q 000417 924 HFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSPKKLELGYSASVENHSENLGSIRKFICRFCGLKFD-------- 995 (1534)
Q Consensus 924 ~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKsF~-------- 995 (1534)
.|. ...|..|+ ..|...+.|+ |++.+ .+..|..|+++|.+.+++.|++|++.|.
T Consensus 462 ~f~-~s~LekH~-~~~Hkpv~Cp-Cg~~~---------------~R~~L~~H~~thCp~Kpi~C~fC~~~v~~g~~~~d~ 523 (567)
T PLN03086 462 AFQ-QGEMEKHM-KVFHEPLQCP-CGVVL---------------EKEQMVQHQASTCPLRLITCRFCGDMVQAGGSAMDV 523 (567)
T ss_pred ccc-hHHHHHHH-HhcCCCccCC-CCCCc---------------chhHHHhhhhccCCCCceeCCCCCCccccCccccch
Confidence 996 67899994 4442334443 33211 1246889999999999999999999995
Q ss_pred --ChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhccc
Q 000417 996 --LLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRP 1038 (1534)
Q Consensus 996 --sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~ 1038 (1534)
..+.|.. |..++ | .+++.|..|++.|..+ .|..|+
T Consensus 524 ~d~~s~Lt~-HE~~C-G-----~rt~~C~~Cgk~Vrlr-dm~~H~ 560 (567)
T PLN03086 524 RDRLRGMSE-HESIC-G-----SRTAPCDSCGRSVMLK-EMDIHQ 560 (567)
T ss_pred hhhhhhHHH-HHHhc-C-----CcceEccccCCeeeeh-hHHHHH
Confidence 2458888 67775 6 7899999999988765 667777
No 26
>PHA00733 hypothetical protein
Probab=98.64 E-value=1.5e-08 Score=104.61 Aligned_cols=87 Identities=10% Similarity=0.050 Sum_probs=70.4
Q ss_pred cccccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCCCCccccCCCchhhhhhhhhcCCcceeeecccCCc
Q 000417 914 MLQQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSPKKLELGYSASVENHSENLGSIRKFICRFCGLK 993 (1534)
Q Consensus 914 kpykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKs 993 (1534)
+++.|.+|.+.|.+...|..| ..|.+|+..| +.+||.|+.||+.
T Consensus 39 ~~~~~~~~~~~~~~~~~l~~~-----------------------------------~~l~~~~~~~-~~kPy~C~~Cgk~ 82 (128)
T PHA00733 39 KRLIRAVVKTLIYNPQLLDES-----------------------------------SYLYKLLTSK-AVSPYVCPLCLMP 82 (128)
T ss_pred hhHHHHHHhhhccChhhhcch-----------------------------------HHHHhhcccC-CCCCccCCCCCCc
Confidence 678899999888888777776 2355665444 4789999999999
Q ss_pred cCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccccCC
Q 000417 994 FDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGL 1044 (1534)
Q Consensus 994 F~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~ge 1044 (1534)
|.+...|.. |++.|+. +|.|+.|++.|.....|.+|++.+++.
T Consensus 83 Fss~s~L~~-H~r~h~~-------~~~C~~CgK~F~~~~sL~~H~~~~h~~ 125 (128)
T PHA00733 83 FSSSVSLKQ-HIRYTEH-------SKVCPVCGKEFRNTDSTLDHVCKKHNI 125 (128)
T ss_pred CCCHHHHHH-HHhcCCc-------CccCCCCCCccCCHHHHHHHHHHhcCc
Confidence 999999999 7777743 689999999999999999999777653
No 27
>KOG2589 consensus Histone tail methylase [Chromatin structure and dynamics]
Probab=98.64 E-value=1.8e-08 Score=115.77 Aligned_cols=117 Identities=23% Similarity=0.309 Sum_probs=88.5
Q ss_pred CCCCccccccccccCCCeEEEeeeEeecHHHHHHHhc-cccCCCcceEEecCcccccccccccCceeEEEeccccCCccc
Q 000417 1387 ENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRS-RYGRDGCGYMLNIGAHINDMGRLIEGQVRYVIDATKYGNVSR 1465 (1534)
Q Consensus 1387 ~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~-~y~~~~~sYlf~ld~~~~d~~~l~~~~~~~~IDA~~~GNvaR 1465 (1534)
...|--|.+++.+.+|+=|--.+|-|+.-.+++++.- +.+..+-+-+|..... .|..+-..|+
T Consensus 135 ~~~gAkivst~~w~~ndkIe~LvGcIaeLse~eE~~ll~~g~nDFSvmyStRk~----------------caqLwLGPaa 198 (453)
T KOG2589|consen 135 SQNGAKIVSTKSWSRNDKIELLVGCIAELSEAEERSLLRGGGNDFSVMYSTRKR----------------CAQLWLGPAA 198 (453)
T ss_pred cCCCceEEeeccccCCccHHHhhhhhhhcChhhhHHHHhccCCceeeeeecccc----------------hhhheeccHH
Confidence 3567788999999999999999999988777777642 2222333344433221 1222334689
Q ss_pred ccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCCCCCCCceeeCCC
Q 000417 1466 FINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYELLSGEGYPCHCGA 1526 (1534)
Q Consensus 1466 FINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~~~~~~~~C~CGS 1526 (1534)
||||-|.|||.+... +..++.+-++|||+||||||--||.+|+......|.|-+
T Consensus 199 fINHDCrpnCkFvs~-------g~~tacvkvlRDIePGeEITcFYgs~fFG~~N~~CeC~T 252 (453)
T KOG2589|consen 199 FINHDCRPNCKFVST-------GRDTACVKVLRDIEPGEEITCFYGSGFFGENNEECECVT 252 (453)
T ss_pred hhcCCCCCCceeecC-------CCceeeeehhhcCCCCceeEEeecccccCCCCceeEEee
Confidence 999999999998442 456789999999999999999999999988888898875
No 28
>KOG1141 consensus Predicted histone methyl transferase [Chromatin structure and dynamics]
Probab=98.46 E-value=1.5e-07 Score=115.98 Aligned_cols=286 Identities=30% Similarity=0.543 Sum_probs=191.3
Q ss_pred CCCceeeecCCCCCCCCCeeEeeCCCCcccccccCCCCCcccccCCCCCCCcEEeccCCCCCCCCCcccCCCCCcccCCC
Q 000417 1228 LRGTVLCDDISSGLESVPVACVVDDGLLETLCISADSSDSQKTRCSMPWESFTYVTKPLLDQSLDLDAESLQLGCACANS 1307 (1534)
Q Consensus 1228 ~~~~~i~~DIS~G~E~vPV~~vnd~D~~~~~~~~g~~~~~~~~~~~~P~~~F~Yi~~~~~~~~~~~d~e~~~~GC~C~~~ 1307 (1534)
...++-..|.+.|.+.+|||.||.+|...++.-+ ++. ..|.|.-+.... + ....+..||.|..
T Consensus 871 D~~g~d~~d~~~g~sg~~~p~~~~~d~~~~~~c~----d~~--------~~~~~~~~~~~s-~---~~~~~~~~~s~d~- 933 (1262)
T KOG1141|consen 871 DDKGLDVADFSLGTSGIPIPLVNSVDNDEPPSCE----DSK--------RRFQYNDQVDIS-S---VSRDFCSGCSCDG- 933 (1262)
T ss_pred cccccchhhhhccccCCCCccccccccCCCcccc----ccc--------eeecccccchhh-h---hccccccccccCC-
Confidence 3455667899999999999999988864322111 111 134443321111 1 2345778999975
Q ss_pred CcC-CCCCCcccccccccccccc---cCCCCcCCCcccCCCCceeecCCceEEecCCCCCCCCCCCCcccccCceeeE--
Q 000417 1308 TCF-PETCDHVYLFDNDYEDAKD---IDGKSVHGRFPYDQTGRVILEEGYLIYECNHMCSCDRTCPNRVLQNGVRVKL-- 1381 (1534)
Q Consensus 1308 ~C~-p~~C~C~~l~~~~y~~~~~---i~g~~~~g~~~Yd~~G~l~~~~~~~IyECn~~C~C~~~C~NRvvQ~g~~~~L-- 1381 (1534)
.|. -+.|.|.++.-........ ..|...--.-+|+.+..+ ...+|||++.|.|...|.||++|++.+++.
T Consensus 934 hp~d~~~~~~~~~~~~~~~~cpp~~s~d~~~~~~eS~~~~ns~~----~~~f~e~~~hss~~~~e~~~~v~~~~~~~me~ 1009 (1262)
T KOG1141|consen 934 HPSDASKCECQQLSIEAMKRCPPNLSFDGHDELYESSEKQNSFL----KLFFFECNDHSSCHRKEYNRVVQNNIKYPMEV 1009 (1262)
T ss_pred CCcccCcccCCCCChhhhcCCCCccccCchhhhhhhhhhcchhh----hccceeccccchhcccccchhhhcCCccceee
Confidence 453 3678886543221111000 000000000112222211 235789999999999999999999988775
Q ss_pred ------EEEecCCCCccccccccccCCCeEEEeeeEeecHHHHHHHhc----cccCC----------------CcceEEe
Q 000417 1382 ------EVFKTENKGWAVRAGQAILRGTFVCEYIGEVLDELETNKRRS----RYGRD----------------GCGYMLN 1435 (1534)
Q Consensus 1382 ------eVf~T~~kGwGVrA~edI~kGtfI~EY~GEIit~~ea~~R~~----~y~~~----------------~~sYlf~ 1435 (1534)
.||++...|||+++..||+.-+|||+|+|...++.-+.+-.. .|... ..+|--+
T Consensus 1010 ~s~~~l~i~~~~~~~~~~~edtD~~~~~~~~~~~~~ppt~~l~~~~r~aqad~~sn~~D~~~~~~l~es~~~~~T~~r~~ 1089 (1262)
T KOG1141|consen 1010 SSFNDLQIFKTAQSGWGVREDTDIPQSTFICTYVGAPPTDDLADELRNAQADQYSNDLDLKDTVELEESREDHETDFRGD 1089 (1262)
T ss_pred eecccccccccccccccccccccCCCCcccccccCCCCchhhHHHHhhhhhccccCccchhhhhhhhhcccccccccCCC
Confidence 466777899999999999999999999999988766554221 11100 0000000
Q ss_pred c---------Cccc----------cc----------ccc-----------------------------------------
Q 000417 1436 I---------GAHI----------ND----------MGR----------------------------------------- 1445 (1534)
Q Consensus 1436 l---------d~~~----------~d----------~~~----------------------------------------- 1445 (1534)
. +... .+ +.|
T Consensus 1090 t~~~~~~~~~d~dd~q~I~k~ve~qd~~~~~~~T~~~~RQ~~~~s~k~~~~~s~~~~~~ts~~~~~~dkges~~~~~~~~ 1169 (1262)
T KOG1141|consen 1090 TSDYDDEEGSDGDDGQDIMKMVERQDSSESGEETKRLTRQKRKQSKKSGKGGSVEKDDTTSRDSMEKDKGESKDEPVFNW 1169 (1262)
T ss_pred CCCCcccccccCccHHHHHHHhhcccccccccccchhhhhhhhhhhhcccCccccccccCccchhhhccCccCcccccch
Confidence 0 0000 00 000
Q ss_pred --cccCceeEEEeccccCCcccccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCC--CCCCCce
Q 000417 1446 --LIEGQVRYVIDATKYGNVSRFINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYEL--LSGEGYP 1521 (1534)
Q Consensus 1446 --l~~~~~~~~IDA~~~GNvaRFINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~--~~~~~~~ 1521 (1534)
..+...-|+|||+.-||++||+||||.||+.+|+|+++++|.++|++||||.|-|+||+||||||+|.. ...+...
T Consensus 1170 ~~y~~~~~~yvIDAk~eGNlGRfLNHSC~PNl~VQnVfvdTHdlrfPwVAFFt~kyVkAgtELTWDY~Ye~g~v~~keL~ 1249 (1262)
T KOG1141|consen 1170 DKYFEPFPLYVIDAKQEGNLGRFLNHSCDPNLHVQNVFVDTHDLRFPWVAFFTRKYVKAGTELTWDYQYEQGQVATKELT 1249 (1262)
T ss_pred hhccCCCceEEEecccccchhhhhccCCCccceeeeeeeeccccCCchhhhhhhhhhccCceeeeeccccccccccceEE
Confidence 001125699999999999999999999999999999999999999999999999999999999999986 4566889
Q ss_pred eeCCCCCCccccC
Q 000417 1522 CHCGASKCRGRLY 1534 (1534)
Q Consensus 1522 C~CGS~~CRG~l~ 1534 (1534)
|+||+.+|||+|+
T Consensus 1250 C~CGa~~CrgrLL 1262 (1262)
T KOG1141|consen 1250 CHCGAENCRGRLL 1262 (1262)
T ss_pred EecChhhhhcccC
Confidence 9999999999996
No 29
>PHA00733 hypothetical protein
Probab=98.30 E-value=3.1e-07 Score=94.98 Aligned_cols=81 Identities=5% Similarity=-0.033 Sum_probs=67.7
Q ss_pred CcceeeecccCCccCChhHHHHH-HHh---hccCCCCCCCCCcccCCCCcccCCchhhhcccccccCCCCccCCCCCCcC
Q 000417 981 SIRKFICRFCGLKFDLLPDLGRH-HQA---AHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRIRNRGA 1056 (1534)
Q Consensus 981 geKpykC~~CgKsF~sks~LkrH-H~r---tHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~iCgksF 1056 (1534)
..+++.|.+|.+.|.....|..| ..+ .+.+ .+||.|+.|++.|.+...|..|++.| ..+|.|..|++.|
T Consensus 37 ~~~~~~~~~~~~~~~~~~~l~~~~~l~~~~~~~~-----~kPy~C~~Cgk~Fss~s~L~~H~r~h--~~~~~C~~CgK~F 109 (128)
T PHA00733 37 EQKRLIRAVVKTLIYNPQLLDESSYLYKLLTSKA-----VSPYVCPLCLMPFSSSVSLKQHIRYT--EHSKVCPVCGKEF 109 (128)
T ss_pred hhhhHHHHHHhhhccChhhhcchHHHHhhcccCC-----CCCccCCCCCCcCCCHHHHHHHHhcC--CcCccCCCCCCcc
Confidence 34789999999999988777764 022 2223 68999999999999999999999987 4579999999999
Q ss_pred CChHHHHhhccc
Q 000417 1057 AGMKKRIQTLKP 1068 (1534)
Q Consensus 1057 s~~~~L~kH~Ks 1068 (1534)
.....|..|+..
T Consensus 110 ~~~~sL~~H~~~ 121 (128)
T PHA00733 110 RNTDSTLDHVCK 121 (128)
T ss_pred CCHHHHHHHHHH
Confidence 999999999863
No 30
>KOG3993 consensus Transcription factor (contains Zn finger) [Transcription]
Probab=98.28 E-value=2.3e-07 Score=108.62 Aligned_cols=187 Identities=14% Similarity=0.090 Sum_probs=113.6
Q ss_pred cCCCcccCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcccccccc-----------
Q 000417 843 EDEKTHKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVE----------- 911 (1534)
Q Consensus 843 ~gekpykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~----------- 911 (1534)
+.-.-|.|.+|...|.+...|.+| +-.-.-. --|+|++|+|.|....+|..|.|.|.......
T Consensus 263 n~iGdyiCqLCK~kYeD~F~LAQH-rC~RIV~-----vEYrCPEC~KVFsCPANLASHRRWHKPR~eaa~a~~~P~k~~~ 336 (500)
T KOG3993|consen 263 NVIGDYICQLCKEKYEDAFALAQH-RCPRIVH-----VEYRCPECDKVFSCPANLASHRRWHKPRPEAAKAGSPPPKQAV 336 (500)
T ss_pred ccHHHHHHHHHHHhhhhHHHHhhc-cCCeeEE-----eeecCCcccccccCchhhhhhhcccCCchhhhhcCCCChhhhh
Confidence 334469999999999999999999 4332222 34999999999999999999999986442221
Q ss_pred ----------------cccccccccCCCccCChHHHhhhhhccccCcccchhhhhhcc-cccCCCCCccccCCCchhhh-
Q 000417 912 ----------------QCMLQQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHN-QSVGEDSPKKLELGYSASVE- 973 (1534)
Q Consensus 912 ----------------~~kpykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~-~~~geKp~~C~~Cgk~~sLk- 973 (1534)
....|.|.+|+|+|.....|+.| +..|...-.-..-.-.|. .....--+.|..|...+.+.
T Consensus 337 ~~rae~~ea~rsg~dss~gi~~C~~C~KkFrRqAYLrKH-qlthq~~~~~k~~a~~f~~s~~~~l~~~~~~~a~h~~a~~ 415 (500)
T KOG3993|consen 337 ETRAEVQEAERSGDDSSSGIFSCHTCGKKFRRQAYLRKH-QLTHQRAPLAKEKAPKFLLSRVIPLMHFNQAVATHSSASD 415 (500)
T ss_pred hhhhhhhhccccCCcccCceeecHHhhhhhHHHHHHHHh-HHhhhccccchhcccCcchhhccccccccccccccccccc
Confidence 11469999999999999999999 555532100000000011 10011112333333222111
Q ss_pred ---hhhhhcCC-cceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccc-ccc
Q 000417 974 ---NHSENLGS-IRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPR-FKK 1042 (1534)
Q Consensus 974 ---~HlrtHtg-eKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r-~H~ 1042 (1534)
.|..-+.+ ..-..|++||-.+.++..-.. +.+.-.. +..|.|.+|.-.|.+..+|.+|+. -|-
T Consensus 416 ~~g~~vl~~a~sael~~pp~~~~ppsss~~sgg-~~rlg~~-----~q~f~~ky~~atfyss~~ltrhin~~Hp 483 (500)
T KOG3993|consen 416 SHGDEVLYVAGSAELELPPYDGSPPSSSGSSGG-YGRLGIA-----EQGFTCKYCPATFYSSPGLTRHINKCHP 483 (500)
T ss_pred ccccceeeeeccccccCCCCCCCCcccCCCCCc-cccccch-----hhccccccchHhhhcCcchHhHhhhcCh
Confidence 11111111 122457788877777665544 2222222 456888888888888888888884 443
No 31
>PHA02768 hypothetical protein; Provisional
Probab=98.09 E-value=6.5e-07 Score=78.84 Aligned_cols=42 Identities=14% Similarity=0.064 Sum_probs=22.6
Q ss_pred eeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhh
Q 000417 985 FICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGR 1034 (1534)
Q Consensus 985 ykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L 1034 (1534)
|+|+.||+.|.+.++|.. |+++|+. +|+|..|++.|.+.+.|
T Consensus 6 y~C~~CGK~Fs~~~~L~~-H~r~H~k-------~~kc~~C~k~f~~~s~l 47 (55)
T PHA02768 6 YECPICGEIYIKRKSMIT-HLRKHNT-------NLKLSNCKRISLRTGEY 47 (55)
T ss_pred cCcchhCCeeccHHHHHH-HHHhcCC-------cccCCcccceeccccee
Confidence 555555555555555555 4555542 45555555555555444
No 32
>PHA02768 hypothetical protein; Provisional
Probab=98.06 E-value=2e-06 Score=75.78 Aligned_cols=45 Identities=11% Similarity=-0.033 Sum_probs=41.7
Q ss_pred CcccCCCCcccCCchhhhcccccccCCCCccCCCCCCcCCChHHHHh
Q 000417 1018 PHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRIRNRGAAGMKKRIQ 1064 (1534)
Q Consensus 1018 pYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~iCgksFs~~~~L~k 1064 (1534)
.|+|+.||+.|.+.++|..|+++|+ ++|+|..|++.|.+.+.|+.
T Consensus 5 ~y~C~~CGK~Fs~~~~L~~H~r~H~--k~~kc~~C~k~f~~~s~l~~ 49 (55)
T PHA02768 5 GYECPICGEIYIKRKSMITHLRKHN--TNLKLSNCKRISLRTGEYIE 49 (55)
T ss_pred ccCcchhCCeeccHHHHHHHHHhcC--CcccCCcccceecccceeEE
Confidence 5899999999999999999999999 79999999999998887764
No 33
>KOG3993 consensus Transcription factor (contains Zn finger) [Transcription]
Probab=98.03 E-value=2.1e-06 Score=100.78 Aligned_cols=171 Identities=18% Similarity=0.219 Sum_probs=112.8
Q ss_pred ccccCccCcccCChHHHHhHhhhcccccccccccccccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCCC
Q 000417 881 GYACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDS 960 (1534)
Q Consensus 881 pykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp 960 (1534)
-|.|..|...|...-.|.+|.-..--. .-|+|++|+|.|+-..+|..| ++.|...- .-.+ .+..+
T Consensus 267 dyiCqLCK~kYeD~F~LAQHrC~RIV~------vEYrCPEC~KVFsCPANLASH-RRWHKPR~---eaa~-----a~~~P 331 (500)
T KOG3993|consen 267 DYICQLCKEKYEDAFALAQHRCPRIVH------VEYRCPECDKVFSCPANLASH-RRWHKPRP---EAAK-----AGSPP 331 (500)
T ss_pred HHHHHHHHHhhhhHHHHhhccCCeeEE------eeecCCcccccccCchhhhhh-hcccCCch---hhhh-----cCCCC
Confidence 399999999999999999996321111 248999999999999999999 99996220 0000 11111
Q ss_pred CccccCCCchhhhhhhh--hcCCcceeeecccCCccCChhHHHHHHHhhccCC-CCC-----------------------
Q 000417 961 PKKLELGYSASVENHSE--NLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMGP-NLV----------------------- 1014 (1534)
Q Consensus 961 ~~C~~Cgk~~sLk~Hlr--tHtgeKpykC~~CgKsF~sks~LkrHH~rtHtge-~~~----------------------- 1014 (1534)
-+-. -..+...++-.| ....+.-|.|.+|+|+|.++..|++ |+.+|... ...
T Consensus 332 ~k~~-~~~rae~~ea~rsg~dss~gi~~C~~C~KkFrRqAYLrK-Hqlthq~~~~~k~~a~~f~~s~~~~l~~~~~~~a~ 409 (500)
T KOG3993|consen 332 PKQA-VETRAEVQEAERSGDDSSSGIFSCHTCGKKFRRQAYLRK-HQLTHQRAPLAKEKAPKFLLSRVIPLMHFNQAVAT 409 (500)
T ss_pred hhhh-hhhhhhhhhccccCCcccCceeecHHhhhhhHHHHHHHH-hHHhhhccccchhcccCcchhhccccccccccccc
Confidence 1100 000000000011 0122357999999999999999999 66666531 100
Q ss_pred -----------------CCCCcccCCCCcccCCchhhhcccccccCCCCccCCCCCCcCCChHHHHhhccc
Q 000417 1015 -----------------NSRPHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRIRNRGAAGMKKRIQTLKP 1068 (1534)
Q Consensus 1015 -----------------~eKpYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~iCgksFs~~~~L~kH~Ks 1068 (1534)
......|++|+-.+.++..--.|.+.-..+..|.|.+|.-.|.....|.+|...
T Consensus 410 h~~a~~~~g~~vl~~a~sael~~pp~~~~ppsss~~sgg~~rlg~~~q~f~~ky~~atfyss~~ltrhin~ 480 (500)
T KOG3993|consen 410 HSSASDSHGDEVLYVAGSAELELPPYDGSPPSSSGSSGGYGRLGIAEQGFTCKYCPATFYSSPGLTRHINK 480 (500)
T ss_pred ccccccccccceeeeeccccccCCCCCCCCcccCCCCCccccccchhhccccccchHhhhcCcchHhHhhh
Confidence 022235677777777777777777776677779999999999999999998763
No 34
>KOG2461 consensus Transcription factor BLIMP-1/PRDI-BF1, contains C2H2-type Zn-finger and SET domains [Transcription]
Probab=97.79 E-value=2.3e-05 Score=94.91 Aligned_cols=114 Identities=26% Similarity=0.262 Sum_probs=85.1
Q ss_pred ceeeEEEEecC--CCCccccccccccCCCeEEEeeeEe-ecHHHHHHHhccccCCCcceEEecCcccccccccccCceeE
Q 000417 1377 VRVKLEVFKTE--NKGWAVRAGQAILRGTFVCEYIGEV-LDELETNKRRSRYGRDGCGYMLNIGAHINDMGRLIEGQVRY 1453 (1534)
Q Consensus 1377 ~~~~LeVf~T~--~kGwGVrA~edI~kGtfI~EY~GEI-it~~ea~~R~~~y~~~~~sYlf~ld~~~~d~~~l~~~~~~~ 1453 (1534)
+...|.|+.+. ..|.||++...|++|+--+-|.|++ ++..+ ...+..|++.+-.. +..-+
T Consensus 26 LP~~l~i~~Ssv~~~~lgV~s~~~i~~G~~FGP~~G~~~~~~~~--------~~~n~~y~W~I~~~---------d~~~~ 88 (396)
T KOG2461|consen 26 LPPELRIKPSSVPVTGLGVWSNASILPGTSFGPFEGEIIASIDS--------KSANNRYMWEIFSS---------DNGYE 88 (396)
T ss_pred CCCceEeeccccCCccccccccccccCcccccCccCcccccccc--------ccccCcceEEEEeC---------CCceE
Confidence 66678888774 4789999999999999999999998 22211 11223466655331 12468
Q ss_pred EEeccc--cCCcccccccCCC---CCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCCCCC
Q 000417 1454 VIDATK--YGNVSRFINHSCF---PNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHYELL 1515 (1534)
Q Consensus 1454 ~IDA~~--~GNvaRFINHSC~---PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~~~~ 1515 (1534)
+||++. ..|+.||+|=+++ -|+.+... ...|.++|+|+|++||||.+.|+.++.
T Consensus 89 ~iDg~d~~~sNWmRYV~~Ar~~eeQNL~A~Q~--------~~~Ifyrt~r~I~p~eELlVWY~~e~~ 147 (396)
T KOG2461|consen 89 YIDGTDEEHSNWMRYVNSARSEEEQNLLAFQI--------GENIFYRTIRDIRPNEELLVWYGSEYA 147 (396)
T ss_pred EeccCChhhcceeeeecccCChhhhhHHHHhc--------cCceEEEecccCCCCCeEEEEeccchH
Confidence 999875 7999999999998 57766332 234889999999999999999998863
No 35
>PF13465 zf-H2C2_2: Zinc-finger double domain; PDB: 2EN7_A 1TF6_A 1TF3_A 2ELT_A 2EOS_A 2EN2_A 2DMD_A 2WBS_A 2WBU_A 2EM5_A ....
Probab=97.58 E-value=2.9e-05 Score=58.75 Aligned_cols=24 Identities=21% Similarity=0.654 Sum_probs=12.1
Q ss_pred hhhhhhhcCCcceeeecccCCccC
Q 000417 972 VENHSENLGSIRKFICRFCGLKFD 995 (1534)
Q Consensus 972 Lk~HlrtHtgeKpykC~~CgKsF~ 995 (1534)
|..|+++|++++||+|+.|+++|.
T Consensus 2 l~~H~~~H~~~k~~~C~~C~k~F~ 25 (26)
T PF13465_consen 2 LRRHMRTHTGEKPYKCPYCGKSFS 25 (26)
T ss_dssp HHHHHHHHSSSSSEEESSSSEEES
T ss_pred HHHHhhhcCCCCCCCCCCCcCeeC
Confidence 444555555555555555555543
No 36
>PHA00732 hypothetical protein
Probab=97.37 E-value=0.00012 Score=69.85 Aligned_cols=48 Identities=21% Similarity=0.214 Sum_probs=31.6
Q ss_pred eeeecccCCccCChhHHHHHHHh-hccCCCCCCCCCcccCCCCcccCCchhhhcccccccC
Q 000417 984 KFICRFCGLKFDLLPDLGRHHQA-AHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKG 1043 (1534)
Q Consensus 984 pykC~~CgKsF~sks~LkrHH~r-tHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~g 1043 (1534)
||+|+.||+.|.+..+|.. |++ .|++ +.|+.|++.|. .|..|++++..
T Consensus 1 py~C~~Cgk~F~s~s~Lk~-H~r~~H~~--------~~C~~CgKsF~---~l~~H~~~~~~ 49 (79)
T PHA00732 1 MFKCPICGFTTVTLFALKQ-HARRNHTL--------TKCPVCNKSYR---RLNQHFYSQYD 49 (79)
T ss_pred CccCCCCCCccCCHHHHHH-HhhcccCC--------CccCCCCCEeC---ChhhhhcccCC
Confidence 4677777777777777777 454 3543 46777777776 46667655544
No 37
>PF13465 zf-H2C2_2: Zinc-finger double domain; PDB: 2EN7_A 1TF6_A 1TF3_A 2ELT_A 2EOS_A 2EN2_A 2DMD_A 2WBS_A 2WBU_A 2EM5_A ....
Probab=97.32 E-value=0.00013 Score=55.26 Aligned_cols=25 Identities=28% Similarity=0.402 Sum_probs=18.1
Q ss_pred HHHHHHHhhccCCCCCCCCCcccCCCCcccC
Q 000417 999 DLGRHHQAAHMGPNLVNSRPHKKGIRFYAYK 1029 (1534)
Q Consensus 999 ~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~ 1029 (1534)
+|.+ |+++|++ ++||+|++|+++|.
T Consensus 1 ~l~~-H~~~H~~-----~k~~~C~~C~k~F~ 25 (26)
T PF13465_consen 1 NLRR-HMRTHTG-----EKPYKCPYCGKSFS 25 (26)
T ss_dssp HHHH-HHHHHSS-----SSSEEESSSSEEES
T ss_pred CHHH-HhhhcCC-----CCCCCCCCCcCeeC
Confidence 4667 6677777 77777777777775
No 38
>PHA00616 hypothetical protein
Probab=97.21 E-value=6.6e-05 Score=63.52 Aligned_cols=26 Identities=19% Similarity=0.280 Sum_probs=13.2
Q ss_pred eeeecccCCccCChhHHHHHHHhhccC
Q 000417 984 KFICRFCGLKFDLLPDLGRHHQAAHMG 1010 (1534)
Q Consensus 984 pykC~~CgKsF~sks~LkrHH~rtHtg 1010 (1534)
||+|+.||+.|..+++|.+ |++.|+|
T Consensus 1 pYqC~~CG~~F~~~s~l~~-H~r~~hg 26 (44)
T PHA00616 1 MYQCLRCGGIFRKKKEVIE-HLLSVHK 26 (44)
T ss_pred CCccchhhHHHhhHHHHHH-HHHHhcC
Confidence 3455555555555555555 4444444
No 39
>PHA00732 hypothetical protein
Probab=97.09 E-value=0.00026 Score=67.59 Aligned_cols=46 Identities=11% Similarity=-0.099 Sum_probs=38.8
Q ss_pred CcccCCCCcccCCchhhhccccc-ccCCCCccCCCCCCcCCChHHHHhhcccc
Q 000417 1018 PHKKGIRFYAYKLKSGRLSRPRF-KKGLGAVSYRIRNRGAAGMKKRIQTLKPL 1069 (1534)
Q Consensus 1018 pYkC~iC~K~F~sks~L~rH~r~-H~gekpy~C~iCgksFs~~~~L~kH~KsH 1069 (1534)
||.|+.|++.|.+..+|+.|++. |+ ++.|+.|++.|.+ +..|.+++
T Consensus 1 py~C~~Cgk~F~s~s~Lk~H~r~~H~---~~~C~~CgKsF~~---l~~H~~~~ 47 (79)
T PHA00732 1 MFKCPICGFTTVTLFALKQHARRNHT---LTKCPVCNKSYRR---LNQHFYSQ 47 (79)
T ss_pred CccCCCCCCccCCHHHHHHHhhcccC---CCccCCCCCEeCC---hhhhhccc
Confidence 68999999999999999999985 65 3689999999984 66666644
No 40
>PF05605 zf-Di19: Drought induced 19 protein (Di19), zinc-binding; InterPro: IPR008598 This entry consists of several drought induced 19 (Di19) like and RING finger 114 proteins. Di19 has been found to be strongly expressed in both the roots and leaves of Arabidopsis thaliana during progressive drought [], whilst RING finger proteins are thought to play a role in spermatogenesis. The precise function is unknown.
Probab=97.07 E-value=0.00035 Score=61.88 Aligned_cols=53 Identities=17% Similarity=0.162 Sum_probs=42.7
Q ss_pred eeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccccC
Q 000417 984 KFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKG 1043 (1534)
Q Consensus 984 pykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~g 1043 (1534)
.|.|++|++ ..+...|..|....|..+ .+.+.|++|...+. .+|.+|+..+++
T Consensus 2 ~f~CP~C~~-~~~~~~L~~H~~~~H~~~----~~~v~CPiC~~~~~--~~l~~Hl~~~H~ 54 (54)
T PF05605_consen 2 SFTCPYCGK-GFSESSLVEHCEDEHRSE----SKNVVCPICSSRVT--DNLIRHLNSQHR 54 (54)
T ss_pred CcCCCCCCC-ccCHHHHHHHHHhHCcCC----CCCccCCCchhhhh--hHHHHHHHHhcC
Confidence 489999999 456788999888889884 46799999998755 489999977653
No 41
>PHA00616 hypothetical protein
Probab=96.93 E-value=0.00029 Score=59.68 Aligned_cols=34 Identities=3% Similarity=-0.224 Sum_probs=32.1
Q ss_pred CcccCCCCcccCCchhhhcccccccCCCCccCCC
Q 000417 1018 PHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRI 1051 (1534)
Q Consensus 1018 pYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~i 1051 (1534)
||+|+.||+.|.+++.|.+|++.|||+++++|+.
T Consensus 1 pYqC~~CG~~F~~~s~l~~H~r~~hg~~~~~~~~ 34 (44)
T PHA00616 1 MYQCLRCGGIFRKKKEVIEHLLSVHKQNKLTLEY 34 (44)
T ss_pred CCccchhhHHHhhHHHHHHHHHHhcCCCccceeE
Confidence 6999999999999999999999999999998864
No 42
>PF05605 zf-Di19: Drought induced 19 protein (Di19), zinc-binding; InterPro: IPR008598 This entry consists of several drought induced 19 (Di19) like and RING finger 114 proteins. Di19 has been found to be strongly expressed in both the roots and leaves of Arabidopsis thaliana during progressive drought [], whilst RING finger proteins are thought to play a role in spermatogenesis. The precise function is unknown.
Probab=96.88 E-value=0.00084 Score=59.49 Aligned_cols=52 Identities=27% Similarity=0.587 Sum_probs=34.3
Q ss_pred cccCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcc
Q 000417 847 THKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERH 905 (1534)
Q Consensus 847 pykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh 905 (1534)
.|.||.|++ ..+...|..|+...|..+. +.+.|++|...+. .+|..|+..+|
T Consensus 2 ~f~CP~C~~-~~~~~~L~~H~~~~H~~~~----~~v~CPiC~~~~~--~~l~~Hl~~~H 53 (54)
T PF05605_consen 2 SFTCPYCGK-GFSESSLVEHCEDEHRSES----KNVVCPICSSRVT--DNLIRHLNSQH 53 (54)
T ss_pred CcCCCCCCC-ccCHHHHHHHHHhHCcCCC----CCccCCCchhhhh--hHHHHHHHHhc
Confidence 467777777 4455677777777776652 4577777776544 37777776655
No 43
>COG5189 SFP1 Putative transcriptional repressor regulating G2/M transition [Transcription / Cell division and chromosome partitioning]
Probab=96.72 E-value=0.00084 Score=76.94 Aligned_cols=57 Identities=19% Similarity=0.280 Sum_probs=46.1
Q ss_pred cceeeecc--cCCccCChhHHHHHHHhhccCCCC-------------CCCCCcccCCCCcccCCchhhhccc
Q 000417 982 IRKFICRF--CGLKFDLLPDLGRHHQAAHMGPNL-------------VNSRPHKKGIRFYAYKLKSGRLSRP 1038 (1534)
Q Consensus 982 eKpykC~~--CgKsF~sks~LkrHH~rtHtge~~-------------~~eKpYkC~iC~K~F~sks~L~rH~ 1038 (1534)
+|||+|++ |.|+|+....|+-|.+.-|..+.. .+.|||.|++|+|+|+....|+.|.
T Consensus 347 ~KpykCpV~gC~K~YknqnGLKYH~lhGH~~~~~~~~p~p~~~~~F~~~~KPYrCevC~KRYKNlNGLKYHr 418 (423)
T COG5189 347 GKPYKCPVEGCNKKYKNQNGLKYHMLHGHQNQKLHENPSPEKMNIFSAKDKPYRCEVCDKRYKNLNGLKYHR 418 (423)
T ss_pred CceecCCCCCchhhhccccchhhhhhccccCcccCCCCCccccccccccCCceeccccchhhccCccceecc
Confidence 59999976 999999999999976666643211 2368999999999999999999995
No 44
>PF12756 zf-C2H2_2: C2H2 type zinc-finger (2 copies); PDB: 2DMI_A.
Probab=95.71 E-value=0.0057 Score=59.37 Aligned_cols=72 Identities=22% Similarity=0.396 Sum_probs=16.7
Q ss_pred ccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCCCCccccCCCchhhhhhhhhcCCcceeeecccCCccCC
Q 000417 917 QCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSPKKLELGYSASVENHSENLGSIRKFICRFCGLKFDL 996 (1534)
Q Consensus 917 kC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKsF~s 996 (1534)
+|..|+..|.+...|..|+...|.-.+.. .........+..+.+.-. ...+.|..|++.|.+
T Consensus 1 ~C~~C~~~f~~~~~l~~H~~~~H~~~~~~-----------------~~~l~~~~~~~~~~~~~~-~~~~~C~~C~~~f~s 62 (100)
T PF12756_consen 1 QCLFCDESFSSVDDLLQHMKKKHGFDIPD-----------------QKYLVDPNRLLNYLRKKV-KESFRCPYCNKTFRS 62 (100)
T ss_dssp ------------------------------------------------------------------SSEEBSSSS-EESS
T ss_pred Ccccccccccccccccccccccccccccc-----------------cccccccccccccccccc-CCCCCCCccCCCCcC
Confidence 49999999999999999988888622110 000001111222222111 125788888888888
Q ss_pred hhHHHHHHHhh
Q 000417 997 LPDLGRHHQAA 1007 (1534)
Q Consensus 997 ks~LkrHH~rt 1007 (1534)
...|.. |++.
T Consensus 63 ~~~l~~-Hm~~ 72 (100)
T PF12756_consen 63 REALQE-HMRS 72 (100)
T ss_dssp HHHHHH-HHHH
T ss_pred HHHHHH-HHcC
Confidence 888888 4443
No 45
>PF00096 zf-C2H2: Zinc finger, C2H2 type; InterPro: IPR007087 Zinc finger (Znf) domains are relatively small protein motifs which contain multiple finger-like protrusions that make tandem contacts with their target molecule. Some of these domains bind zinc, but many do not; instead binding other metals such as iron, or no metal at all. For example, some family members form salt bridges to stabilise the finger-like folds. They were first identified as a DNA-binding motif in transcription factor TFIIIA from Xenopus laevis (African clawed frog), however they are now recognised to bind DNA, RNA, protein and/or lipid substrates [, , , , ]. Their binding properties depend on the amino acid sequence of the finger domains and of the linker between fingers, as well as on the higher-order structures and the number of fingers. Znf domains are often found in clusters, where fingers can have different binding specificities. There are many superfamilies of Znf motifs, varying in both sequence and structure. They display considerable versatility in binding modes, even between members of the same class (e.g. some bind DNA, others protein), suggesting that Znf motifs are stable scaffolds that have evolved specialised functions. For example, Znf-containing proteins function in gene transcription, translation, mRNA trafficking, cytoskeleton organisation, epithelial development, cell adhesion, protein folding, chromatin remodelling and zinc sensing, to name but a few []. Zinc-binding motifs are stable structures, and they rarely undergo conformational changes upon binding their target. The C2H2 zinc finger is the classical zinc finger domain. The two conserved cysteines and histidines co-ordinate a zinc ion. The following pattern describes the zinc finger: #-X-C-X(1-5)-C-X3-#-X5-#-X2-H-X(3-6)-[H/C], where X can be any amino acid, and numbers in brackets indicate the number of residues. The positions marked # are those that are important for the stable fold of the zinc finger. The final position can be either his or cys. The C2H2 zinc finger is composed of two short beta strands followed by an alpha helix. The amino terminal part of the helix binds the major groove in DNA binding zinc fingers. The accepted consensus binding sequence for Sp1 is usually defined by the asymmetric hexanucleotide core GGGCGG but this sequence does not include, among others, the GAG (=CTC) repeat that constitutes a high-affinity site for Sp1 binding to the wt1 promoter []. This entry represents the classical C2H2 zinc finger domain. More information about these proteins can be found at Protein of the Month: Zinc Fingers [].; GO: 0008270 zinc ion binding, 0005622 intracellular; PDB: 2D9H_A 2EPC_A 1SP1_A 1VA3_A 2WBT_B 2ELR_A 2YTP_A 2YTT_A 1VA1_A 2ELO_A ....
Probab=95.63 E-value=0.006 Score=44.37 Aligned_cols=23 Identities=35% Similarity=0.782 Sum_probs=14.0
Q ss_pred eeecccCCccCChhHHHHHHHhhc
Q 000417 985 FICRFCGLKFDLLPDLGRHHQAAH 1008 (1534)
Q Consensus 985 ykC~~CgKsF~sks~LkrHH~rtH 1008 (1534)
|+|+.|++.|.++..|.+ |++.|
T Consensus 1 y~C~~C~~~f~~~~~l~~-H~~~H 23 (23)
T PF00096_consen 1 YKCPICGKSFSSKSNLKR-HMRRH 23 (23)
T ss_dssp EEETTTTEEESSHHHHHH-HHHHH
T ss_pred CCCCCCCCccCCHHHHHH-HHhHC
Confidence 566666666666666666 44434
No 46
>PF00096 zf-C2H2: Zinc finger, C2H2 type; InterPro: IPR007087 Zinc finger (Znf) domains are relatively small protein motifs which contain multiple finger-like protrusions that make tandem contacts with their target molecule. Some of these domains bind zinc, but many do not; instead binding other metals such as iron, or no metal at all. For example, some family members form salt bridges to stabilise the finger-like folds. They were first identified as a DNA-binding motif in transcription factor TFIIIA from Xenopus laevis (African clawed frog), however they are now recognised to bind DNA, RNA, protein and/or lipid substrates [, , , , ]. Their binding properties depend on the amino acid sequence of the finger domains and of the linker between fingers, as well as on the higher-order structures and the number of fingers. Znf domains are often found in clusters, where fingers can have different binding specificities. There are many superfamilies of Znf motifs, varying in both sequence and structure. They display considerable versatility in binding modes, even between members of the same class (e.g. some bind DNA, others protein), suggesting that Znf motifs are stable scaffolds that have evolved specialised functions. For example, Znf-containing proteins function in gene transcription, translation, mRNA trafficking, cytoskeleton organisation, epithelial development, cell adhesion, protein folding, chromatin remodelling and zinc sensing, to name but a few []. Zinc-binding motifs are stable structures, and they rarely undergo conformational changes upon binding their target. The C2H2 zinc finger is the classical zinc finger domain. The two conserved cysteines and histidines co-ordinate a zinc ion. The following pattern describes the zinc finger: #-X-C-X(1-5)-C-X3-#-X5-#-X2-H-X(3-6)-[H/C], where X can be any amino acid, and numbers in brackets indicate the number of residues. The positions marked # are those that are important for the stable fold of the zinc finger. The final position can be either his or cys. The C2H2 zinc finger is composed of two short beta strands followed by an alpha helix. The amino terminal part of the helix binds the major groove in DNA binding zinc fingers. The accepted consensus binding sequence for Sp1 is usually defined by the asymmetric hexanucleotide core GGGCGG but this sequence does not include, among others, the GAG (=CTC) repeat that constitutes a high-affinity site for Sp1 binding to the wt1 promoter []. This entry represents the classical C2H2 zinc finger domain. More information about these proteins can be found at Protein of the Month: Zinc Fingers [].; GO: 0008270 zinc ion binding, 0005622 intracellular; PDB: 2D9H_A 2EPC_A 1SP1_A 1VA3_A 2WBT_B 2ELR_A 2YTP_A 2YTT_A 1VA1_A 2ELO_A ....
Probab=95.63 E-value=0.0029 Score=46.06 Aligned_cols=23 Identities=22% Similarity=-0.042 Sum_probs=19.2
Q ss_pred cccCCCCcccCCchhhhcccccc
Q 000417 1019 HKKGIRFYAYKLKSGRLSRPRFK 1041 (1534)
Q Consensus 1019 YkC~iC~K~F~sks~L~rH~r~H 1041 (1534)
|+|+.|++.|.++..|.+|++.|
T Consensus 1 y~C~~C~~~f~~~~~l~~H~~~H 23 (23)
T PF00096_consen 1 YKCPICGKSFSSKSNLKRHMRRH 23 (23)
T ss_dssp EEETTTTEEESSHHHHHHHHHHH
T ss_pred CCCCCCCCccCCHHHHHHHHhHC
Confidence 67888888888888888888764
No 47
>COG5189 SFP1 Putative transcriptional repressor regulating G2/M transition [Transcription / Cell division and chromosome partitioning]
Probab=95.60 E-value=0.0042 Score=71.40 Aligned_cols=67 Identities=19% Similarity=0.400 Sum_probs=41.5
Q ss_pred CCcccCCC--CCcccCChhhHhhhhhcccCccccccCCccccC--ccCcccCChHHHHhHhhhccccccccccccccccc
Q 000417 845 EKTHKCKI--CSQVFLHDQELGVHWMDNHKKEAQWLFRGYACA--ICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIP 920 (1534)
Q Consensus 845 ekpykC~~--CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~--~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~ 920 (1534)
+|||+|++ |+|.|+....|+-|+..-|... +.+.=+ +=-..| ....|||+|++
T Consensus 347 ~KpykCpV~gC~K~YknqnGLKYH~lhGH~~~-----~~~~~p~p~~~~~F------------------~~~~KPYrCev 403 (423)
T COG5189 347 GKPYKCPVEGCNKKYKNQNGLKYHMLHGHQNQ-----KLHENPSPEKMNIF------------------SAKDKPYRCEV 403 (423)
T ss_pred CceecCCCCCchhhhccccchhhhhhccccCc-----ccCCCCCccccccc------------------cccCCceeccc
Confidence 58999986 9999999999999955445332 111100 000111 11226777777
Q ss_pred CCCccCChHHHhhh
Q 000417 921 CGSHFGNTEELWLH 934 (1534)
Q Consensus 921 CgK~Fssk~~Lk~H 934 (1534)
|+|.+.+...|+.|
T Consensus 404 C~KRYKNlNGLKYH 417 (423)
T COG5189 404 CDKRYKNLNGLKYH 417 (423)
T ss_pred cchhhccCccceec
Confidence 77777777777777
No 48
>PF12756 zf-C2H2_2: C2H2 type zinc-finger (2 copies); PDB: 2DMI_A.
Probab=95.59 E-value=0.0053 Score=59.58 Aligned_cols=73 Identities=19% Similarity=0.302 Sum_probs=19.7
Q ss_pred cCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcccccccccccccccccCCCccCCh
Q 000417 849 KCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNT 928 (1534)
Q Consensus 849 kC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk 928 (1534)
+|..|+..|.+...|..|+...|.-. .+ ....+.....+..+++.... ..+.|..|++.|.+.
T Consensus 1 ~C~~C~~~f~~~~~l~~H~~~~H~~~-----~~-----~~~~l~~~~~~~~~~~~~~~-------~~~~C~~C~~~f~s~ 63 (100)
T PF12756_consen 1 QCLFCDESFSSVDDLLQHMKKKHGFD-----IP-----DQKYLVDPNRLLNYLRKKVK-------ESFRCPYCNKTFRSR 63 (100)
T ss_dssp -----------------------------------------------------------------SSEEBSSSS-EESSH
T ss_pred Cccccccccccccccccccccccccc-----cc-----cccccccccccccccccccC-------CCCCCCccCCCCcCH
Confidence 59999999999999999987888654 11 12223344445455432221 247899999999999
Q ss_pred HHHhhhhhcc
Q 000417 929 EELWLHVQSV 938 (1534)
Q Consensus 929 ~~Lk~H~~rv 938 (1534)
..|..||+..
T Consensus 64 ~~l~~Hm~~~ 73 (100)
T PF12756_consen 64 EALQEHMRSK 73 (100)
T ss_dssp HHHHHHHHHT
T ss_pred HHHHHHHcCc
Confidence 9999996543
No 49
>KOG1146 consensus Homeobox protein [General function prediction only]
Probab=95.31 E-value=0.0064 Score=80.90 Aligned_cols=177 Identities=15% Similarity=0.171 Sum_probs=109.6
Q ss_pred cCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhcccccccc-----------------
Q 000417 849 KCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFVE----------------- 911 (1534)
Q Consensus 849 kC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~~----------------- 911 (1534)
.|..|+..+.+...+.-|+...|... +.|+|+.|+..|+....|..|||..|.+....
T Consensus 438 e~~~~e~~~~s~r~~~~~t~~L~S~~-----kt~~cpkc~~~yk~a~~L~vhmRskhp~~~~~~c~~gq~~~~~arg~~~ 512 (1406)
T KOG1146|consen 438 ELTKAEPLLESKRSLEGQTVVLHSFF-----KTLKCPKCNWHYKLAQTLGVHMRSKHPESQSAYCKAGQNHPRLARGEVY 512 (1406)
T ss_pred cccchhhhhhhhcccccceeeeeccc-----ccccCCccchhhhhHHHhhhcccccccccchhHhHhccccccccccccc
Confidence 46677778888888888877777665 88999999999999999999999855432111
Q ss_pred --cccccccccCCCccCChHHHhhhhhcc-ccCcccchhhhhhcccccCC----CCC-ccccCCCchhhhhhhhh--cCC
Q 000417 912 --QCMLQQCIPCGSHFGNTEELWLHVQSV-HAIDFKMSEVAQQHNQSVGE----DSP-KKLELGYSASVENHSEN--LGS 981 (1534)
Q Consensus 912 --~~kpykC~~CgK~Fssk~~Lk~H~~rv-H~~ef~C~~C~k~f~~~~ge----Kp~-~C~~Cgk~~sLk~Hlrt--Htg 981 (1534)
..++|.|..|...++.+.+|.+|++.. |..+ .+......++ .+. .|..+.....+-.-.-. -..
T Consensus 513 ~~~~~p~~C~~C~~stttng~LsihlqS~~h~~~------lee~~~~~g~~v~~~~~~v~s~~P~~ag~~~~ags~~pkt 586 (1406)
T KOG1146|consen 513 RCPGKPYPCRACNYSTTTNGNLSIHLQSDLHRNE------LEEAEENAGEQVRLLPASVTSAVPEEAGLGPSAGSSGPKT 586 (1406)
T ss_pred cCCCCcccceeeeeeeecchHHHHHHHHHhhHHH------HHHHHhccccchhhhhhhhcccCcccccCCCCCCCCCCCC
Confidence 127899999999999999999997653 4311 0111110000 000 12222211111100000 011
Q ss_pred cceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccc
Q 000417 982 IRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFK 1041 (1534)
Q Consensus 982 eKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H 1041 (1534)
.-++.|..|+..-.-..+|+.|....|.- ..|--|-.|+-.+.....+..|.+.+
T Consensus 587 kP~~~C~vc~yetniarnlrihmtss~~s-----~~p~~~Lq~~it~~l~~~~~~~~~lp 641 (1406)
T KOG1146|consen 587 KPSWRCEVCSYETNIARNLRIHMTASPSS-----SPPSLVLQQNITSSLASLLGGQGRLP 641 (1406)
T ss_pred CCCcchhhhcchhhhhhccccccccCCCC-----CChHHHhhhcchhhccccccCcCCCC
Confidence 13477888888777777777744444443 44567777777777777777777776
No 50
>PF13894 zf-C2H2_4: C2H2-type zinc finger; PDB: 2ELX_A 2EPP_A 2DLK_A 1X6H_A 2EOU_A 2EMB_A 2GQJ_A 2CSH_A 2WBT_B 2ELM_A ....
Probab=94.65 E-value=0.0092 Score=43.09 Aligned_cols=18 Identities=33% Similarity=0.794 Sum_probs=9.4
Q ss_pred eeecccCCccCChhHHHH
Q 000417 985 FICRFCGLKFDLLPDLGR 1002 (1534)
Q Consensus 985 ykC~~CgKsF~sks~Lkr 1002 (1534)
|.|++|++.|.+...|.+
T Consensus 1 ~~C~~C~~~~~~~~~l~~ 18 (24)
T PF13894_consen 1 FQCPICGKSFRSKSELRQ 18 (24)
T ss_dssp EE-SSTS-EESSHHHHHH
T ss_pred CCCcCCCCcCCcHHHHHH
Confidence 455556666666655555
No 51
>PF13912 zf-C2H2_6: C2H2-type zinc finger; PDB: 1JN7_A 1FU9_A 2L1O_A 1NJQ_A 2EN8_A 2EMM_A 1FV5_A 1Y0J_B 2L6Z_B.
Probab=94.47 E-value=0.015 Score=44.00 Aligned_cols=23 Identities=9% Similarity=-0.159 Sum_probs=10.0
Q ss_pred cccCCCCcccCCchhhhcccccc
Q 000417 1019 HKKGIRFYAYKLKSGRLSRPRFK 1041 (1534)
Q Consensus 1019 YkC~iC~K~F~sks~L~rH~r~H 1041 (1534)
|+|..|++.|.+...|..|++.|
T Consensus 2 ~~C~~C~~~F~~~~~l~~H~~~h 24 (27)
T PF13912_consen 2 FECDECGKTFSSLSALREHKRSH 24 (27)
T ss_dssp EEETTTTEEESSHHHHHHHHCTT
T ss_pred CCCCccCCccCChhHHHHHhHHh
Confidence 34444444444444444444443
No 52
>PF13894 zf-C2H2_4: C2H2-type zinc finger; PDB: 2ELX_A 2EPP_A 2DLK_A 1X6H_A 2EOU_A 2EMB_A 2GQJ_A 2CSH_A 2WBT_B 2ELM_A ....
Probab=94.37 E-value=0.025 Score=40.80 Aligned_cols=22 Identities=36% Similarity=0.738 Sum_probs=9.1
Q ss_pred ccCccCcccCChHHHHhHhhhc
Q 000417 883 ACAICLDSFTNKKVLESHVQER 904 (1534)
Q Consensus 883 kC~~CgKsF~sks~L~~H~r~H 904 (1534)
.|++|++.|.+...|..|++.|
T Consensus 2 ~C~~C~~~~~~~~~l~~H~~~~ 23 (24)
T PF13894_consen 2 QCPICGKSFRSKSELRQHMRTH 23 (24)
T ss_dssp E-SSTS-EESSHHHHHHHHHHH
T ss_pred CCcCCCCcCCcHHHHHHHHHhh
Confidence 3444444444444444444433
No 53
>KOG2231 consensus Predicted E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=93.95 E-value=0.063 Score=68.67 Aligned_cols=11 Identities=45% Similarity=1.165 Sum_probs=8.0
Q ss_pred ccCCCCCcccC
Q 000417 848 HKCKICSQVFL 858 (1534)
Q Consensus 848 ykC~~CgK~F~ 858 (1534)
+.|.+|++.|.
T Consensus 100 ~~C~~C~~~~~ 110 (669)
T KOG2231|consen 100 HSCHICDRRFR 110 (669)
T ss_pred hhcCccccchh
Confidence 67888877763
No 54
>PF13912 zf-C2H2_6: C2H2-type zinc finger; PDB: 1JN7_A 1FU9_A 2L1O_A 1NJQ_A 2EN8_A 2EMM_A 1FV5_A 1Y0J_B 2L6Z_B.
Probab=93.92 E-value=0.034 Score=42.02 Aligned_cols=26 Identities=35% Similarity=0.686 Sum_probs=23.3
Q ss_pred eeeecccCCccCChhHHHHHHHhhccC
Q 000417 984 KFICRFCGLKFDLLPDLGRHHQAAHMG 1010 (1534)
Q Consensus 984 pykC~~CgKsF~sks~LkrHH~rtHtg 1010 (1534)
||+|..|++.|.+...|.. |++.|..
T Consensus 1 ~~~C~~C~~~F~~~~~l~~-H~~~h~~ 26 (27)
T PF13912_consen 1 PFECDECGKTFSSLSALRE-HKRSHCS 26 (27)
T ss_dssp SEEETTTTEEESSHHHHHH-HHCTTTT
T ss_pred CCCCCccCCccCChhHHHH-HhHHhcC
Confidence 6899999999999999999 7787754
No 55
>PF09237 GAGA: GAGA factor; InterPro: IPR015318 Zinc finger (Znf) domains are relatively small protein motifs which contain multiple finger-like protrusions that make tandem contacts with their target molecule. Some of these domains bind zinc, but many do not; instead binding other metals such as iron, or no metal at all. For example, some family members form salt bridges to stabilise the finger-like folds. They were first identified as a DNA-binding motif in transcription factor TFIIIA from Xenopus laevis (African clawed frog), however they are now recognised to bind DNA, RNA, protein and/or lipid substrates [, , , , ]. Their binding properties depend on the amino acid sequence of the finger domains and of the linker between fingers, as well as on the higher-order structures and the number of fingers. Znf domains are often found in clusters, where fingers can have different binding specificities. There are many superfamilies of Znf motifs, varying in both sequence and structure. They display considerable versatility in binding modes, even between members of the same class (e.g. some bind DNA, others protein), suggesting that Znf motifs are stable scaffolds that have evolved specialised functions. For example, Znf-containing proteins function in gene transcription, translation, mRNA trafficking, cytoskeleton organisation, epithelial development, cell adhesion, protein folding, chromatin remodelling and zinc sensing, to name but a few []. Zinc-binding motifs are stable structures, and they rarely undergo conformational changes upon binding their target. Members of this entry bind to a 5'-GAGAG-3' DNA consensus binding site, and contain a Cys2-His2 zinc finger core as well as an N-terminal extension containing two highly basic regions. The zinc finger core binds in the DNA major groove and recognises the first three GAG bases of the consensus in a manner similar to that seen in other classical zinc finger-DNA complexes. The second basic region forms a helix that interacts in the major groove recognising the last G of the consensus, while the first basic region wraps around the DNA in the minor groove and recognises the A in the fourth position of the consensus sequence []. More information about these proteins can be found at Protein of the Month: Zinc Fingers [].; PDB: 1YUI_A 1YUJ_A.
Probab=93.25 E-value=0.028 Score=49.13 Aligned_cols=31 Identities=6% Similarity=-0.108 Sum_probs=16.6
Q ss_pred CCCcccCCCCcccCCchhhhcccccccCCCC
Q 000417 1016 SRPHKKGIRFYAYKLKSGRLSRPRFKKGLGA 1046 (1534)
Q Consensus 1016 eKpYkC~iC~K~F~sks~L~rH~r~H~gekp 1046 (1534)
+.|..|++|+..+++..+|++|+..+|+.||
T Consensus 22 ~~PatCP~C~a~~~~srnLrRHle~~H~~k~ 52 (54)
T PF09237_consen 22 EQPATCPICGAVIRQSRNLRRHLEIRHFKKP 52 (54)
T ss_dssp S--EE-TTT--EESSHHHHHHHHHHHTTTS-
T ss_pred CCCCCCCcchhhccchhhHHHHHHHHhcccC
Confidence 5566677777777777777777666665554
No 56
>smart00508 PostSET Cysteine-rich motif following a subset of SET domains.
Probab=93.04 E-value=0.047 Score=41.62 Aligned_cols=15 Identities=60% Similarity=1.325 Sum_probs=13.8
Q ss_pred CceeeCCCCCCcccc
Q 000417 1519 GYPCHCGASKCRGRL 1533 (1534)
Q Consensus 1519 ~~~C~CGS~~CRG~l 1533 (1534)
.++|+|||.+|||+|
T Consensus 2 ~~~C~CGs~~CRG~l 16 (26)
T smart00508 2 KQPCLCGAPNCRGFL 16 (26)
T ss_pred CeeeeCCCcccccee
Confidence 479999999999998
No 57
>KOG2231 consensus Predicted E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=92.99 E-value=0.087 Score=67.46 Aligned_cols=109 Identities=21% Similarity=0.127 Sum_probs=56.3
Q ss_pred cccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCCCCcccc-CCCchhhhhhhhhc-CCcc----eeeecccC
Q 000417 918 CIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSPKKLE-LGYSASVENHSENL-GSIR----KFICRFCG 991 (1534)
Q Consensus 918 C~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~~C~~-Cgk~~sLk~HlrtH-tgeK----pykC~~Cg 991 (1534)
|..| ..|.....|+.|+...|. -+.|..|... .+-+.|.. +-.+..|..|++.- .+++ .-.|..|.
T Consensus 118 ~~~c-~~~~s~~~Lk~H~~~~H~-~~~c~lC~~~------~kif~~e~k~Yt~~el~~h~~~gd~d~~s~rGhp~C~~C~ 189 (669)
T KOG2231|consen 118 CLHC-TEFKSVENLKNHMRDQHK-LHLCSLCLQN------LKIFINERKLYTRAELNLHLMFGDPDDESCRGHPLCKFCH 189 (669)
T ss_pred Cccc-cchhHHHHHHHHHHHhhh-hhcccccccc------ceeeeeeeehehHHHHHHHHhcCCCccccccCCccchhhh
Confidence 7777 667777777777656664 2334444331 11111111 11223455555421 1121 23577777
Q ss_pred CccCChhHHHHHHHhhccCCCCCCCCCcccCCCC------cccCCchhhhcccccccCC
Q 000417 992 LKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRF------YAYKLKSGRLSRPRFKKGL 1044 (1534)
Q Consensus 992 KsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~------K~F~sks~L~rH~r~H~ge 1044 (1534)
..|.....|.+|+...| |.|.+|. .-|.....|..|.|.+|-.
T Consensus 190 ~~fld~~el~rH~~~~h----------~~chfC~~~~~~neyy~~~~dLe~HfR~~Hfl 238 (669)
T KOG2231|consen 190 ERFLDDDELYRHLRFDH----------EFCHFCDYKTGQNEYYNDYDDLEEHFRKGHFL 238 (669)
T ss_pred hhhccHHHHHHhhccce----------eheeecCcccccchhcccchHHHHHhhhcCcc
Confidence 77777777777433333 3455553 3455666677777665533
No 58
>KOG1146 consensus Homeobox protein [General function prediction only]
Probab=92.46 E-value=0.066 Score=71.81 Aligned_cols=158 Identities=14% Similarity=0.100 Sum_probs=104.8
Q ss_pred cCccCcccCChHHHHhHhhhcccccccccccccccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccCCCCCcc
Q 000417 884 CAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVGEDSPKK 963 (1534)
Q Consensus 884 C~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~geKp~~C 963 (1534)
|.-|+..+..+..+.-|+..-+... +.|+|+.|+..|.....|..||+..|... .-..|.
T Consensus 439 ~~~~e~~~~s~r~~~~~t~~L~S~~-----kt~~cpkc~~~yk~a~~L~vhmRskhp~~-~~~~c~-------------- 498 (1406)
T KOG1146|consen 439 LTKAEPLLESKRSLEGQTVVLHSFF-----KTLKCPKCNWHYKLAQTLGVHMRSKHPES-QSAYCK-------------- 498 (1406)
T ss_pred ccchhhhhhhhcccccceeeeeccc-----ccccCCccchhhhhHHHhhhccccccccc-chhHhH--------------
Confidence 5556666777777777766544432 67899999999999999999988777521 111111
Q ss_pred ccCCCchhhhhhhhhc------CCcceeeecccCCccCChhHHHHHHHhh-ccCC-------------------------
Q 000417 964 LELGYSASVENHSENL------GSIRKFICRFCGLKFDLLPDLGRHHQAA-HMGP------------------------- 1011 (1534)
Q Consensus 964 ~~Cgk~~sLk~HlrtH------tgeKpykC~~CgKsF~sks~LkrHH~rt-Htge------------------------- 1011 (1534)
.-+.|.+.- .+-++|.|..|..+|..+.+|..|.+.. |..+
T Consensus 499 -------~gq~~~~~arg~~~~~~~~p~~C~~C~~stttng~LsihlqS~~h~~~lee~~~~~g~~v~~~~~~v~s~~P~ 571 (1406)
T KOG1146|consen 499 -------AGQNHPRLARGEVYRCPGKPYPCRACNYSTTTNGNLSIHLQSDLHRNELEEAEENAGEQVRLLPASVTSAVPE 571 (1406)
T ss_pred -------hccccccccccccccCCCCcccceeeeeeeecchHHHHHHHHHhhHHHHHHHHhccccchhhhhhhhcccCcc
Confidence 011111111 1237899999999999999999964432 2110
Q ss_pred ----------C-CCCCCCcccCCCCcccCCchhhhccc-ccccCCCCccCCCCCCcCCChHHHHhhccc
Q 000417 1012 ----------N-LVNSRPHKKGIRFYAYKLKSGRLSRP-RFKKGLGAVSYRIRNRGAAGMKKRIQTLKP 1068 (1534)
Q Consensus 1012 ----------~-~~~eKpYkC~iC~K~F~sks~L~rH~-r~H~gekpy~C~iCgksFs~~~~L~kH~Ks 1068 (1534)
. +...-.+.|.+|++.-.-..+|+.|| ..|+...|.-|-.|+-.+.....+..|.+-
T Consensus 572 ~ag~~~~ags~~pktkP~~~C~vc~yetniarnlrihmtss~~s~~p~~~Lq~~it~~l~~~~~~~~~l 640 (1406)
T KOG1146|consen 572 EAGLGPSAGSSGPKTKPSWRCEVCSYETNIARNLRIHMTASPSSSPPSLVLQQNITSSLASLLGGQGRL 640 (1406)
T ss_pred cccCCCCCCCCCCCCCCCcchhhhcchhhhhhccccccccCCCCCChHHHhhhcchhhccccccCcCCC
Confidence 0 11133589999999999999999999 455555557777777776666655555553
No 59
>cd01395 HMT_MBD Methyl-CpG binding domains (MBD) present in putative histone methyltransferases (HMT) such as CLLD8 and SETDB1 proteins; CLLD8 contains a MBD, a PreSET and a bifurcated SET domain, suggesting that CLLD8 might be associated with methylation-mediated transcriptional repression. SETDB1 and other proteins in this group have a similar domain architecture. SETDB1 is a novel KAP-1-associated histone H3, lysine 9-specific methyltransferase that contributes to HP1-mediated silencing of euchromatic genes by KRAB zinc-finger proteins.
Probab=91.12 E-value=0.048 Score=49.68 Aligned_cols=36 Identities=14% Similarity=0.042 Sum_probs=29.4
Q ss_pred CCC-CCcccc----------cccccccCCCCcCCc-cccccceeeecc
Q 000417 1184 HLE-PLPSVS----------AGIRSSDSSDFVNNQ-WEVDECHCIIDS 1219 (1534)
Q Consensus 1184 p~~-~~~~~~----------~~~k~v~~~~~~~~~-~~~~e~~~~l~~ 1219 (1534)
||+ |+..|| +.++.|+|++|||.. ++|.|+|.||..
T Consensus 1 PL~~Pll~gw~R~~~~~~~~~~k~~V~Y~aPCGr~Lr~~~EV~~YL~~ 48 (60)
T cd01395 1 PLHTPLLCGFQRMKYRARVGKVKKHVIYKAPCGRSLRNMSEVHRYLRE 48 (60)
T ss_pred CcccccccCeEEEEEeccCCCcccceEEECCcchhhhcHHHHHHHHHh
Confidence 566 777777 256679999999999 999999988764
No 60
>smart00355 ZnF_C2H2 zinc finger.
Probab=90.60 E-value=0.17 Score=36.83 Aligned_cols=24 Identities=29% Similarity=0.544 Sum_probs=14.3
Q ss_pred eeecccCCccCChhHHHHHHHhhcc
Q 000417 985 FICRFCGLKFDLLPDLGRHHQAAHM 1009 (1534)
Q Consensus 985 ykC~~CgKsF~sks~LkrHH~rtHt 1009 (1534)
|+|+.|++.|.....|.. |++.|.
T Consensus 1 ~~C~~C~~~f~~~~~l~~-H~~~H~ 24 (26)
T smart00355 1 YRCPECGKVFKSKSALKE-HMRTHX 24 (26)
T ss_pred CCCCCCcchhCCHHHHHH-HHHHhc
Confidence 456666666666666666 444553
No 61
>COG5048 FOG: Zn-finger [General function prediction only]
Probab=90.55 E-value=0.19 Score=60.29 Aligned_cols=62 Identities=11% Similarity=0.084 Sum_probs=43.3
Q ss_pred cCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccccCCCCccCCCCCCc
Q 000417 990 CGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRIRNRG 1055 (1534)
Q Consensus 990 CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~iCgks 1055 (1534)
|-..+.....+.. |...|.... ...+.+..|.+.|.....+..|++.|....++-|..++..
T Consensus 394 ~~~~~~~~~~~~~-~~~~~~~~~---~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 455 (467)
T COG5048 394 CIRNFKRDSNLSL-HIITHLSFR---PYNCKNPPCSKSFNRHYNLIPHKKIHTNHAPLLCSILKSF 455 (467)
T ss_pred hhhhhcccccccc-ccccccccC---CcCCCCCcchhhccCcccccccccccccCCceeecccccc
Confidence 6666677776766 566666511 2356777888888888888888888888777766555543
No 62
>PRK04860 hypothetical protein; Provisional
Probab=90.52 E-value=0.098 Score=56.66 Aligned_cols=39 Identities=15% Similarity=0.136 Sum_probs=27.5
Q ss_pred ceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCc
Q 000417 983 RKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLK 1031 (1534)
Q Consensus 983 KpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sk 1031 (1534)
-+|.|. |++ ....+.+ |.++|++ +++|.|..|+..|...
T Consensus 118 ~~Y~C~-C~~---~~~~~rr-H~ri~~g-----~~~YrC~~C~~~l~~~ 156 (160)
T PRK04860 118 FPYRCK-CQE---HQLTVRR-HNRVVRG-----EAVYRCRRCGETLVFK 156 (160)
T ss_pred EEEEcC-CCC---eeCHHHH-HHHHhcC-----CccEECCCCCceeEEe
Confidence 367776 776 5666667 7777777 6777777777776644
No 63
>PRK04860 hypothetical protein; Provisional
Probab=90.42 E-value=0.16 Score=55.02 Aligned_cols=36 Identities=11% Similarity=-0.039 Sum_probs=23.1
Q ss_pred CcccCCCCcccCCchhhhcccccccCCCCccCCCCCCcCC
Q 000417 1018 PHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRIRNRGAA 1057 (1534)
Q Consensus 1018 pYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~iCgksFs 1057 (1534)
+|.|. |++ ....+++|.++|+++++|.|..|++.|.
T Consensus 119 ~Y~C~-C~~---~~~~~rrH~ri~~g~~~YrC~~C~~~l~ 154 (160)
T PRK04860 119 PYRCK-CQE---HQLTVRRHNRVVRGEAVYRCRRCGETLV 154 (160)
T ss_pred EEEcC-CCC---eeCHHHHHHHHhcCCccEECCCCCceeE
Confidence 56666 665 5556666666666666666666666654
No 64
>COG5236 Uncharacterized conserved protein, contains RING Zn-finger [General function prediction only]
Probab=90.22 E-value=0.17 Score=59.15 Aligned_cols=84 Identities=25% Similarity=0.383 Sum_probs=54.5
Q ss_pred cccCCC--CCcccCChhhHhhhhhcccCccccccCCccccCccCc---ccCC------hHHHHhHhhhcccccccccccc
Q 000417 847 THKCKI--CSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLD---SFTN------KKVLESHVQERHHVQFVEQCML 915 (1534)
Q Consensus 847 pykC~~--CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgK---sF~s------ks~L~~H~r~Hh~ek~~~~~kp 915 (1534)
.|.||. |.........|+.|.+..|.. +-|.+|-+ .|.. +..|..|...-..+..+. .-
T Consensus 151 ~F~CP~skc~~~C~~~k~lk~H~K~~H~~--------~~C~~C~~nKk~F~~E~~lF~~~~Lr~H~~~G~~e~GFK--GH 220 (493)
T COG5236 151 SFKCPKSKCHRRCGSLKELKKHYKAQHGF--------VLCSECIGNKKDFWNEIRLFRSSTLRDHKNGGLEEEGFK--GH 220 (493)
T ss_pred HhcCCchhhhhhhhhHHHHHHHHHhhcCc--------EEhHhhhcCcccCccceeeeecccccccccCCccccCcC--CC
Confidence 488875 777777788899996666643 56777743 3443 445666643221110010 11
Q ss_pred cccccCCCccCChHHHhhhhhcccc
Q 000417 916 QQCIPCGSHFGNTEELWLHVQSVHA 940 (1534)
Q Consensus 916 ykC~~CgK~Fssk~~Lk~H~~rvH~ 940 (1534)
=.|..|...|-+-..|..|++..|.
T Consensus 221 P~C~FC~~~FYdDDEL~~HcR~~HE 245 (493)
T COG5236 221 PLCIFCKIYFYDDDELRRHCRLRHE 245 (493)
T ss_pred chhhhccceecChHHHHHHHHhhhh
Confidence 2599999999999999999777775
No 65
>cd05162 PWWP The PWWP domain, named for a conserved Pro-Trp-Trp-Pro motif, is a small domain consisting of 100-150 amino acids. The PWWP domain is found in numerous proteins that are involved in cell division, growth and differentiation. Most PWWP-domain proteins seem to be nuclear, often DNA-binding, proteins that function as transcription factors regulating a variety of developmental processes. The function of the PWWP domain is still not known precisely; however, based on the fact that other regions of PWWP-domain proteins are responsible for nuclear localization and DNA-binding, is likely that the PWWP domain acts as a site for protein-protein binding interactions, influencing chromatin remodeling and thereby regulating transcriptional processes. Some PWWP-domain proteins have been linked to cancer or other diseases; some are known to function as growth factors.
Probab=89.67 E-value=0.31 Score=47.19 Aligned_cols=60 Identities=18% Similarity=0.474 Sum_probs=47.6
Q ss_pred EEEEEecc-ccccceeeeeccCCCccccccccCCCccEEEEEeccCCcchhhhhhccccccCCCc
Q 000417 157 ALWVKWRG-KWQAGIRCARADWPLPTLKAKPTHDRKKYFVIFFPHTRNYSWADMLLVRSINEFPQ 220 (1534)
Q Consensus 157 ~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 220 (1534)
-+|+|.+| -|--|+-+...+.+... .+......|.|.||+ +++|.||+---|.+..++-.
T Consensus 6 lVwaK~~g~pwWPa~V~~~~~~~~~~---~~~~~~~~~~V~Ffg-~~~~~wv~~~~l~pf~~~~~ 66 (87)
T cd05162 6 LVWAKMKGYPWWPALVVDPPKDSKKA---KKKAKEGKVLVLFFG-DKTFAWVGAERLKPFTEHKE 66 (87)
T ss_pred EEEEeCCCCCCCCEEEccccccchhh---hccCCCCEEEEEEeC-CCcEEEeCccceeeccchHH
Confidence 48999999 78888888777766543 233345789999999 99999999999988887653
No 66
>smart00355 ZnF_C2H2 zinc finger.
Probab=89.36 E-value=0.27 Score=35.69 Aligned_cols=20 Identities=30% Similarity=0.684 Sum_probs=10.4
Q ss_pred ccCccCcccCChHHHHhHhh
Q 000417 883 ACAICLDSFTNKKVLESHVQ 902 (1534)
Q Consensus 883 kC~~CgKsF~sks~L~~H~r 902 (1534)
.|..|++.|.....|..|++
T Consensus 2 ~C~~C~~~f~~~~~l~~H~~ 21 (26)
T smart00355 2 RCPECGKVFKSKSALKEHMR 21 (26)
T ss_pred CCCCCcchhCCHHHHHHHHH
Confidence 45555555555555555554
No 67
>PF09237 GAGA: GAGA factor; InterPro: IPR015318 Zinc finger (Znf) domains are relatively small protein motifs which contain multiple finger-like protrusions that make tandem contacts with their target molecule. Some of these domains bind zinc, but many do not; instead binding other metals such as iron, or no metal at all. For example, some family members form salt bridges to stabilise the finger-like folds. They were first identified as a DNA-binding motif in transcription factor TFIIIA from Xenopus laevis (African clawed frog), however they are now recognised to bind DNA, RNA, protein and/or lipid substrates [, , , , ]. Their binding properties depend on the amino acid sequence of the finger domains and of the linker between fingers, as well as on the higher-order structures and the number of fingers. Znf domains are often found in clusters, where fingers can have different binding specificities. There are many superfamilies of Znf motifs, varying in both sequence and structure. They display considerable versatility in binding modes, even between members of the same class (e.g. some bind DNA, others protein), suggesting that Znf motifs are stable scaffolds that have evolved specialised functions. For example, Znf-containing proteins function in gene transcription, translation, mRNA trafficking, cytoskeleton organisation, epithelial development, cell adhesion, protein folding, chromatin remodelling and zinc sensing, to name but a few []. Zinc-binding motifs are stable structures, and they rarely undergo conformational changes upon binding their target. Members of this entry bind to a 5'-GAGAG-3' DNA consensus binding site, and contain a Cys2-His2 zinc finger core as well as an N-terminal extension containing two highly basic regions. The zinc finger core binds in the DNA major groove and recognises the first three GAG bases of the consensus in a manner similar to that seen in other classical zinc finger-DNA complexes. The second basic region forms a helix that interacts in the major groove recognising the last G of the consensus, while the first basic region wraps around the DNA in the minor groove and recognises the A in the fourth position of the consensus sequence []. More information about these proteins can be found at Protein of the Month: Zinc Fingers [].; PDB: 1YUI_A 1YUJ_A.
Probab=88.50 E-value=0.29 Score=43.09 Aligned_cols=29 Identities=24% Similarity=0.500 Sum_probs=18.4
Q ss_pred CccccCccCcccCChHHHHhHhhhccccc
Q 000417 880 RGYACAICLDSFTNKKVLESHVQERHHVQ 908 (1534)
Q Consensus 880 kpykC~~CgKsF~sks~L~~H~r~Hh~ek 908 (1534)
.|..|++|+..+....+|.+|+..+|+.+
T Consensus 23 ~PatCP~C~a~~~~srnLrRHle~~H~~k 51 (54)
T PF09237_consen 23 QPATCPICGAVIRQSRNLRRHLEIRHFKK 51 (54)
T ss_dssp --EE-TTT--EESSHHHHHHHHHHHTTTS
T ss_pred CCCCCCcchhhccchhhHHHHHHHHhccc
Confidence 67778888888888888888887777653
No 68
>COG5048 FOG: Zn-finger [General function prediction only]
Probab=88.46 E-value=0.28 Score=58.83 Aligned_cols=139 Identities=16% Similarity=0.050 Sum_probs=92.9
Q ss_pred ccccccCCCccCChHHHhhhhhc-cccCcccchhhhhhcccccCC--CCCccc--cCCCch----hhhhhhhhcCCccee
Q 000417 915 LQQCIPCGSHFGNTEELWLHVQS-VHAIDFKMSEVAQQHNQSVGE--DSPKKL--ELGYSA----SVENHSENLGSIRKF 985 (1534)
Q Consensus 915 pykC~~CgK~Fssk~~Lk~H~~r-vH~~ef~C~~C~k~f~~~~ge--Kp~~C~--~Cgk~~----sLk~HlrtHtgeKpy 985 (1534)
++.|..|...|.....|..|... .|. ++ +++.|. .|+..+ .+..|...|.+.+++
T Consensus 289 ~~~~~~~~~~~s~~~~l~~~~~~~~h~----------------~~~~~~~~~p~~~~~~~~~~~~~~~~~~~~~~~~~~~ 352 (467)
T COG5048 289 PIKSKQCNISFSRSSPLTRHLRSVNHS----------------GESLKPFSCPYSLCGKLFSRNDALKRHILLHTSISPA 352 (467)
T ss_pred CCCCccccCCccccccccccccccccc----------------cccCCceeeeccCCCccccccccccCCcccccCCCcc
Confidence 57799999999999999999332 665 44 666676 566444 356677777777777
Q ss_pred eecc--cCCccCChhHHHHHHHhhccCCCCCCCCCcccCC--CCcccCCchhhhcccccccCCC--CccCCCCCCcCCCh
Q 000417 986 ICRF--CGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGI--RFYAYKLKSGRLSRPRFKKGLG--AVSYRIRNRGAAGM 1059 (1534)
Q Consensus 986 kC~~--CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~i--C~K~F~sks~L~rH~r~H~gek--py~C~iCgksFs~~ 1059 (1534)
+|.. |.+.+.....-.. +...+........+.+.|.. |-..+.....+..|...|...+ .+.+..|.+.|...
T Consensus 353 ~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 431 (467)
T COG5048 353 KEKLLNSSSKFSPLLNNEP-PQSLQQYKDLKNDKKSETLSNSCIRNFKRDSNLSLHIITHLSFRPYNCKNPPCSKSFNRH 431 (467)
T ss_pred ccccccCccccccccCCCC-ccchhhccCccCCccccccccchhhhhccccccccccccccccCCcCCCCCcchhhccCc
Confidence 7643 5555544433111 11111111111244555644 8888999999999998888876 46679999999999
Q ss_pred HHHHhhccccC
Q 000417 1060 KKRIQTLKPLA 1070 (1534)
Q Consensus 1060 ~~L~kH~KsH~ 1070 (1534)
..+..|++.|.
T Consensus 432 ~~~~~~~~~~~ 442 (467)
T COG5048 432 YNLIPHKKIHT 442 (467)
T ss_pred ccccccccccc
Confidence 99999988664
No 69
>cd05840 SPBC215_ISWI_like The PWWP domain is a component of the S. pombe hypothetical protein SPBC215, as well as ISWI complex protein 4. The ISWI (imitation switch) proteins are ATPases responsible for chromatin remodeling in eukaryotes, and SPBC215 is proposed to also bind chromatin. The PWWP domain, named for a conserved Pro-Trp-Trp-Pro motif, is a small domain consisting of 100-150 amino acids. The PWWP domain is found in numerous proteins that are involved in cell division, growth and differentiation. Most PWWP-domain proteins seem to be nuclear, often DNA-binding, proteins that function as transcription factors regulating a variety of developmental processes.
Probab=88.14 E-value=0.37 Score=47.80 Aligned_cols=59 Identities=24% Similarity=0.430 Sum_probs=48.9
Q ss_pred EEEEEeccc-cccceeeeeccCCCccccccccCCCccEEEEEeccCCcchhhhhhcccccc
Q 000417 157 ALWVKWRGK-WQAGIRCARADWPLPTLKAKPTHDRKKYFVIFFPHTRNYSWADMLLVRSIN 216 (1534)
Q Consensus 157 ~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 216 (1534)
-+|.|-+|- |=-|+=|...+-|-.-|++++......|.|.||+. ++|.|++--.+.+..
T Consensus 6 lVwaK~~GyPwWPA~V~~~~~~p~~~l~~~~~~~~~~~~V~FFg~-~~~~Wv~~~~l~pl~ 65 (93)
T cd05840 6 RVLAKVKGFPAWPAIVVPEEMLPDSVLKGKKKKNKRTYPVMFFPD-GDYYWVPNKDLKPLT 65 (93)
T ss_pred EEEEeCCCCCCCCEEECChHHCCHHHHhcccCCCCCeEEEEEeCC-CcEEEEChhhcccCC
Confidence 389999994 66777777777888888888888899999999995 699999887777665
No 70
>PF13909 zf-H2C2_5: C2H2-type zinc-finger domain; PDB: 1X5W_A.
Probab=86.88 E-value=0.17 Score=37.32 Aligned_cols=22 Identities=18% Similarity=-0.055 Sum_probs=9.5
Q ss_pred cccCCCCcccCCchhhhcccccc
Q 000417 1019 HKKGIRFYAYKLKSGRLSRPRFK 1041 (1534)
Q Consensus 1019 YkC~iC~K~F~sks~L~rH~r~H 1041 (1534)
|+|+.|++... +..|.+|++.|
T Consensus 1 y~C~~C~y~t~-~~~l~~H~~~~ 22 (24)
T PF13909_consen 1 YKCPHCSYSTS-KSNLKRHLKRH 22 (24)
T ss_dssp EE-SSSS-EES-HHHHHHHHHHH
T ss_pred CCCCCCCCcCC-HHHHHHHHHhh
Confidence 34455554444 44455554443
No 71
>PF11722 zf-TRM13_CCCH: CCCH zinc finger in TRM13 protein; InterPro: IPR021721 This domain is found at the N terminus of TRM13 methyltransferase proteins. It is presumed to be a zinc binding domain. ; GO: 0008168 methyltransferase activity
Probab=85.64 E-value=0.24 Score=39.45 Aligned_cols=29 Identities=28% Similarity=0.619 Sum_probs=27.0
Q ss_pred ccchhhhhhcCCceeeeecCCceEEEEee
Q 000417 533 RQCTAFIESKGRQCVRWANEGDVYCCVHL 561 (1534)
Q Consensus 533 ~~c~a~~~~k~r~c~r~a~~~~~yc~~h~ 561 (1534)
-+|.-||+.|.|.|.-.+..|..||--|+
T Consensus 2 ~~C~f~l~~K~R~C~m~~~~g~~fC~~H~ 30 (31)
T PF11722_consen 2 GRCEFFLPRKKRFCKMTRKPGSRFCGEHM 30 (31)
T ss_pred CcceEECCccccccCCeecCcCCccccCC
Confidence 37999999999999999999999999885
No 72
>PF12874 zf-met: Zinc-finger of C2H2 type; PDB: 1ZU1_A 2KVG_A.
Probab=85.28 E-value=0.26 Score=36.54 Aligned_cols=19 Identities=5% Similarity=-0.127 Sum_probs=8.5
Q ss_pred ccCCCCcccCCchhhhccc
Q 000417 1020 KKGIRFYAYKLKSGRLSRP 1038 (1534)
Q Consensus 1020 kC~iC~K~F~sks~L~rH~ 1038 (1534)
.|.+|++.|.+...|..|+
T Consensus 2 ~C~~C~~~f~s~~~~~~H~ 20 (25)
T PF12874_consen 2 YCDICNKSFSSENSLRQHL 20 (25)
T ss_dssp EETTTTEEESSHHHHHHHH
T ss_pred CCCCCCCCcCCHHHHHHHH
Confidence 3444444444444444444
No 73
>PF12874 zf-met: Zinc-finger of C2H2 type; PDB: 1ZU1_A 2KVG_A.
Probab=85.09 E-value=0.4 Score=35.52 Aligned_cols=20 Identities=35% Similarity=0.808 Sum_probs=10.2
Q ss_pred ccCccCcccCChHHHHhHhh
Q 000417 883 ACAICLDSFTNKKVLESHVQ 902 (1534)
Q Consensus 883 kC~~CgKsF~sks~L~~H~r 902 (1534)
.|.+|++.|.+...|..|++
T Consensus 2 ~C~~C~~~f~s~~~~~~H~~ 21 (25)
T PF12874_consen 2 YCDICNKSFSSENSLRQHLR 21 (25)
T ss_dssp EETTTTEEESSHHHHHHHHT
T ss_pred CCCCCCCCcCCHHHHHHHHC
Confidence 35555555555555555544
No 74
>PF13909 zf-H2C2_5: C2H2-type zinc-finger domain; PDB: 1X5W_A.
Probab=83.95 E-value=0.63 Score=34.34 Aligned_cols=23 Identities=35% Similarity=0.689 Sum_probs=10.2
Q ss_pred cccCccCcccCChHHHHhHhhhcc
Q 000417 882 YACAICLDSFTNKKVLESHVQERH 905 (1534)
Q Consensus 882 ykC~~CgKsF~sks~L~~H~r~Hh 905 (1534)
|+|+.|+.... +..|.+|++.||
T Consensus 1 y~C~~C~y~t~-~~~l~~H~~~~H 23 (24)
T PF13909_consen 1 YKCPHCSYSTS-KSNLKRHLKRHH 23 (24)
T ss_dssp EE-SSSS-EES-HHHHHHHHHHHH
T ss_pred CCCCCCCCcCC-HHHHHHHHHhhC
Confidence 34555555444 445555554443
No 75
>KOG4173 consensus Alpha-SNAP protein [Intracellular trafficking, secretion, and vesicular transport]
Probab=83.60 E-value=0.42 Score=52.83 Aligned_cols=91 Identities=22% Similarity=0.296 Sum_probs=67.5
Q ss_pred CccccCc--cCcccCChHHHHhHhhhcccccccccccccccccCCCccCChHHHhhhhhccccCcccchhhhhhcccccC
Q 000417 880 RGYACAI--CLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQSVG 957 (1534)
Q Consensus 880 kpykC~~--CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~~g 957 (1534)
+.|.|++ |-..|..-.....|..+.|+. .|..|.+.|.+...|..|+...|..- |.
T Consensus 78 ~~~~cqvagc~~~~d~lD~~E~hY~~~h~~---------sCs~C~r~~Pt~hLLd~HI~E~HDs~---------Fq---- 135 (253)
T KOG4173|consen 78 PAFACQVAGCCQVFDALDDYEHHYHTLHGN---------SCSFCKRAFPTGHLLDAHILEWHDSL---------FQ---- 135 (253)
T ss_pred ccccccccchHHHHhhhhhHHHhhhhcccc---------hhHHHHHhCCchhhhhHHHHHHHHHH---------HH----
Confidence 4577887 778888888888887666665 39999999999999999987777510 00
Q ss_pred CCCCccccCCCchhhhhhhhhcCCcceeee--cccCCccCChhHHHHHHHhhccC
Q 000417 958 EDSPKKLELGYSASVENHSENLGSIRKFIC--RFCGLKFDLLPDLGRHHQAAHMG 1010 (1534)
Q Consensus 958 eKp~~C~~Cgk~~sLk~HlrtHtgeKpykC--~~CgKsF~sks~LkrHH~rtHtg 1010 (1534)
..+-.|.--|+| +.|+..|.+..+-+.|..++|.-
T Consensus 136 ------------------a~veRG~dMy~ClvEgCt~KFkT~r~RkdH~I~~Hk~ 172 (253)
T KOG4173|consen 136 ------------------ALVERGQDMYQCLVEGCTEKFKTSRDRKDHMIRMHKY 172 (253)
T ss_pred ------------------HHHHcCccHHHHHHHhhhhhhhhhhhhhhHHHHhccC
Confidence 112234456888 66999999999988988888876
No 76
>PF12171 zf-C2H2_jaz: Zinc-finger double-stranded RNA-binding; InterPro: IPR022755 This zinc finger is found in archaea and eukaryotes, and is approximately 30 amino acids in length. The mammalian members of this group occur multiple times along the protein, joined by flexible linkers, and are referred to as JAZ - dsRNA-binding ZF protein - zinc-fingers. The JAZ proteins are expressed in all tissues tested and localise in the nucleus, particularly the nucleolus []. JAZ preferentially binds to double-stranded (ds) RNA or RNA/DNA hybrids rather than DNA. In addition to binding double-stranded RNA, these zinc-fingers are required for nucleolar localisation. This entry represents the multiple-adjacent-C2H2 zinc finger, JAZ. ; PDB: 4DGW_A 1ZR9_A.
Probab=83.60 E-value=0.64 Score=35.45 Aligned_cols=22 Identities=0% Similarity=-0.277 Sum_probs=16.1
Q ss_pred cccCCCCcccCCchhhhccccc
Q 000417 1019 HKKGIRFYAYKLKSGRLSRPRF 1040 (1534)
Q Consensus 1019 YkC~iC~K~F~sks~L~rH~r~ 1040 (1534)
|.|..|++.|.+...|..|++.
T Consensus 2 ~~C~~C~k~f~~~~~~~~H~~s 23 (27)
T PF12171_consen 2 FYCDACDKYFSSENQLKQHMKS 23 (27)
T ss_dssp CBBTTTTBBBSSHHHHHCCTTS
T ss_pred CCcccCCCCcCCHHHHHHHHcc
Confidence 5677777777777777777754
No 77
>COG5236 Uncharacterized conserved protein, contains RING Zn-finger [General function prediction only]
Probab=83.44 E-value=0.62 Score=54.82 Aligned_cols=130 Identities=19% Similarity=0.248 Sum_probs=73.7
Q ss_pred ccccCc--cCcccCChHHHHhHhhhcccccccccccccccccCC---CccCChHHHhhhhhccccCcccchhhhhhcccc
Q 000417 881 GYACAI--CLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCG---SHFGNTEELWLHVQSVHAIDFKMSEVAQQHNQS 955 (1534)
Q Consensus 881 pykC~~--CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~Cg---K~Fssk~~Lk~H~~rvH~~ef~C~~C~k~f~~~ 955 (1534)
.|.|+. |......-..|+.|.+..|+. +.|.+|- +.|...-.|-.
T Consensus 151 ~F~CP~skc~~~C~~~k~lk~H~K~~H~~--------~~C~~C~~nKk~F~~E~~lF~---------------------- 200 (493)
T COG5236 151 SFKCPKSKCHRRCGSLKELKKHYKAQHGF--------VLCSECIGNKKDFWNEIRLFR---------------------- 200 (493)
T ss_pred HhcCCchhhhhhhhhHHHHHHHHHhhcCc--------EEhHhhhcCcccCccceeeee----------------------
Confidence 467764 666666677888898877765 4588774 23332211110
Q ss_pred cCCCCCccccCCCchhhhhhhhhcCCc---c-eeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcc----
Q 000417 956 VGEDSPKKLELGYSASVENHSENLGSI---R-KFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYA---- 1027 (1534)
Q Consensus 956 ~geKp~~C~~Cgk~~sLk~HlrtHtge---K-pykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~---- 1027 (1534)
...|..|...-..+ | .-.|.+|.+.|..-..|.+|.+..|.. |.+|++.
T Consensus 201 -------------~~~Lr~H~~~G~~e~GFKGHP~C~FC~~~FYdDDEL~~HcR~~HE~----------ChICD~v~p~~ 257 (493)
T COG5236 201 -------------SSTLRDHKNGGLEEEGFKGHPLCIFCKIYFYDDDELRRHCRLRHEA----------CHICDMVGPIR 257 (493)
T ss_pred -------------cccccccccCCccccCcCCCchhhhccceecChHHHHHHHHhhhhh----------hhhhhccCccc
Confidence 11233333221111 1 235888888888888888855555543 6666543
Q ss_pred ---cCCchhhhcccccccCCCCccCC--CCC----CcCCChHHHHhhcc
Q 000417 1028 ---YKLKSGRLSRPRFKKGLGAVSYR--IRN----RGAAGMKKRIQTLK 1067 (1534)
Q Consensus 1028 ---F~sks~L~rH~r~H~gekpy~C~--iCg----ksFs~~~~L~kH~K 1067 (1534)
|+.-..|..|.+.-| |.|. .|. ..|..-..|+.|.-
T Consensus 258 ~QYFK~Y~~Le~HF~~~h----y~ct~qtc~~~k~~vf~~~~el~~h~~ 302 (493)
T COG5236 258 YQYFKSYEDLEAHFRNAH----YCCTFQTCRVGKCYVFPYHTELLEHLT 302 (493)
T ss_pred hhhhhCHHHHHHHhhcCc----eEEEEEEEecCcEEEeccHHHHHHHHH
Confidence 667777777774322 3331 121 34566667777753
No 78
>smart00570 AWS associated with SET domains. subdomain of PRESET
Probab=82.05 E-value=0.54 Score=41.69 Aligned_cols=24 Identities=33% Similarity=0.830 Sum_probs=21.4
Q ss_pred ceEEecCCCCCCCCCCCCcccccC
Q 000417 1353 YLIYECNHMCSCDRTCPNRVLQNG 1376 (1534)
Q Consensus 1353 ~~IyECn~~C~C~~~C~NRvvQ~g 1376 (1534)
.+.+||++.|.|+..|.||.+|+.
T Consensus 26 ~l~~EC~~~C~~G~~C~NqrFqk~ 49 (51)
T smart00570 26 MLLIECSSDCPCGSYCSNQRFQKR 49 (51)
T ss_pred HHhhhcCCCCCCCcCccCcccccC
Confidence 356899999999999999999975
No 79
>KOG4173 consensus Alpha-SNAP protein [Intracellular trafficking, secretion, and vesicular transport]
Probab=81.23 E-value=0.44 Score=52.68 Aligned_cols=87 Identities=24% Similarity=0.526 Sum_probs=68.8
Q ss_pred CCcccCCC--CCcccCChhhHhhhhhcccCccccccCCccccCccCcccCChHHHHhHhhhccccccc----cccccccc
Q 000417 845 EKTHKCKI--CSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNKKVLESHVQERHHVQFV----EQCMLQQC 918 (1534)
Q Consensus 845 ekpykC~~--CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sks~L~~H~r~Hh~ek~~----~~~kpykC 918 (1534)
-+.|.|++ |...|.....+..|.-..|+.. |..|.+.|.+...|..|+...|..-+. .+.-.|+|
T Consensus 77 ~~~~~cqvagc~~~~d~lD~~E~hY~~~h~~s---------Cs~C~r~~Pt~hLLd~HI~E~HDs~Fqa~veRG~dMy~C 147 (253)
T KOG4173|consen 77 VPAFACQVAGCCQVFDALDDYEHHYHTLHGNS---------CSFCKRAFPTGHLLDAHILEWHDSLFQALVERGQDMYQC 147 (253)
T ss_pred cccccccccchHHHHhhhhhHHHhhhhcccch---------hHHHHHhCCchhhhhHHHHHHHHHHHHHHHHcCccHHHH
Confidence 35688886 8899999999999965666654 999999999999999999866643110 01146889
Q ss_pred c--cCCCccCChHHHhhhhhcccc
Q 000417 919 I--PCGSHFGNTEELWLHVQSVHA 940 (1534)
Q Consensus 919 ~--~CgK~Fssk~~Lk~H~~rvH~ 940 (1534)
- -|+..|.+...-+.|+.+.|.
T Consensus 148 lvEgCt~KFkT~r~RkdH~I~~Hk 171 (253)
T KOG4173|consen 148 LVEGCTEKFKTSRDRKDHMIRMHK 171 (253)
T ss_pred HHHhhhhhhhhhhhhhhHHHHhcc
Confidence 4 599999999999999989996
No 80
>KOG2785 consensus C2H2-type Zn-finger protein [General function prediction only]
Probab=80.36 E-value=2.4 Score=51.22 Aligned_cols=26 Identities=27% Similarity=0.354 Sum_probs=18.1
Q ss_pred eeeecccCCccCChhHHHHHHHhhccC
Q 000417 984 KFICRFCGLKFDLLPDLGRHHQAAHMG 1010 (1534)
Q Consensus 984 pykC~~CgKsF~sks~LkrHH~rtHtg 1010 (1534)
|-.|-.|++.|.+...-.+ ||..|+|
T Consensus 166 Pt~CLfC~~~~k~~e~~~~-HM~~~Hg 191 (390)
T KOG2785|consen 166 PTDCLFCDKKSKSLEENLK-HMFKEHG 191 (390)
T ss_pred CcceeecCCCcccHHHHHH-HHhhccC
Confidence 4567788888887777777 5555555
No 81
>KOG2482 consensus Predicted C2H2-type Zn-finger protein [Transcription]
Probab=79.56 E-value=3.1 Score=49.42 Aligned_cols=26 Identities=23% Similarity=0.300 Sum_probs=22.7
Q ss_pred eeecccCCccCChhHHHHHHHhhccC
Q 000417 985 FICRFCGLKFDLLPDLGRHHQAAHMG 1010 (1534)
Q Consensus 985 ykC~~CgKsF~sks~LkrHH~rtHtg 1010 (1534)
.+|-.|.....+...|..|+..+|.=
T Consensus 280 v~CLfC~~~~en~~~l~eHmk~vHe~ 305 (423)
T KOG2482|consen 280 VVCLFCTNFYENPVFLFEHMKIVHEF 305 (423)
T ss_pred eEEEeeccchhhHHHHHHHHHHHHHh
Confidence 69999999999999999987778853
No 82
>KOG2084 consensus Predicted histone tail methylase containing SET domain [Chromatin structure and dynamics]
Probab=79.15 E-value=2.3 Score=52.79 Aligned_cols=53 Identities=38% Similarity=0.729 Sum_probs=38.2
Q ss_pred ccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCC-eEEEEcCCCCCCC----------CCceeeCCC
Q 000417 1466 FINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGE-ELTYDYHYELLSG----------EGYPCHCGA 1526 (1534)
Q Consensus 1466 FINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGE-ELT~DYg~~~~~~----------~~~~C~CGS 1526 (1534)
++||||.||+.+ ..+ .....+.+..++.+++ ||++.|....++. ..|.|.|+.
T Consensus 208 ~~~hsC~pn~~~---~~~-----~~~~~~~~~~~~~~~~~~l~~~y~~~~~~~~~r~~~l~~~~~f~c~c~r 271 (482)
T KOG2084|consen 208 LFNHSCFPNISV---IFD-----GRGLALLVPAGIDAGEEELTISYTDPLLSTASRQKQLRQSKLFSCQCPR 271 (482)
T ss_pred hcccCCCCCeEE---EEC-----CceeEEEeecccCCCCCEEEEeecccccCHHHHHHHHhhccceeeecCC
Confidence 779999999982 222 2346677888888887 9999998876542 136777764
No 83
>PF12171 zf-C2H2_jaz: Zinc-finger double-stranded RNA-binding; InterPro: IPR022755 This zinc finger is found in archaea and eukaryotes, and is approximately 30 amino acids in length. The mammalian members of this group occur multiple times along the protein, joined by flexible linkers, and are referred to as JAZ - dsRNA-binding ZF protein - zinc-fingers. The JAZ proteins are expressed in all tissues tested and localise in the nucleus, particularly the nucleolus []. JAZ preferentially binds to double-stranded (ds) RNA or RNA/DNA hybrids rather than DNA. In addition to binding double-stranded RNA, these zinc-fingers are required for nucleolar localisation. This entry represents the multiple-adjacent-C2H2 zinc finger, JAZ. ; PDB: 4DGW_A 1ZR9_A.
Probab=78.27 E-value=1.1 Score=34.10 Aligned_cols=21 Identities=24% Similarity=0.695 Sum_probs=11.4
Q ss_pred cccCccCcccCChHHHHhHhh
Q 000417 882 YACAICLDSFTNKKVLESHVQ 902 (1534)
Q Consensus 882 ykC~~CgKsF~sks~L~~H~r 902 (1534)
|.|..|++.|.+...|..|++
T Consensus 2 ~~C~~C~k~f~~~~~~~~H~~ 22 (27)
T PF12171_consen 2 FYCDACDKYFSSENQLKQHMK 22 (27)
T ss_dssp CBBTTTTBBBSSHHHHHCCTT
T ss_pred CCcccCCCCcCCHHHHHHHHc
Confidence 445555555555555555554
No 84
>KOG2482 consensus Predicted C2H2-type Zn-finger protein [Transcription]
Probab=75.13 E-value=2.8 Score=49.78 Aligned_cols=23 Identities=9% Similarity=-0.123 Sum_probs=17.6
Q ss_pred CcccCCCCcccCCchhhhccccc
Q 000417 1018 PHKKGIRFYAYKLKSGRLSRPRF 1040 (1534)
Q Consensus 1018 pYkC~iC~K~F~sks~L~rH~r~ 1040 (1534)
.-.|-.|.-.|.....|..||.-
T Consensus 334 ~~~c~~cd~~F~~e~~l~~hm~e 356 (423)
T KOG2482|consen 334 KSRCAECDLSFWKEPGLLIHMVE 356 (423)
T ss_pred ccccccccccccCcchhhhhccc
Confidence 34577777889999999999843
No 85
>KOG2893 consensus Zn finger protein [General function prediction only]
Probab=69.43 E-value=1.8 Score=48.93 Aligned_cols=48 Identities=27% Similarity=0.517 Sum_probs=38.8
Q ss_pred ccCccCcccCChHHHHhHhhhcccccccccccccccccCCCccCChHHHhhhhhcccc
Q 000417 883 ACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNTEELWLHVQSVHA 940 (1534)
Q Consensus 883 kC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk~~Lk~H~~rvH~ 940 (1534)
-|-+|++.|.....|.+|++..| |+|.+|.|..-+-..|..|.+.+|.
T Consensus 12 wcwycnrefddekiliqhqkakh----------fkchichkkl~sgpglsihcmqvhk 59 (341)
T KOG2893|consen 12 WCWYCNREFDDEKILIQHQKAKH----------FKCHICHKKLFSGPGLSIHCMQVHK 59 (341)
T ss_pred eeeecccccchhhhhhhhhhhcc----------ceeeeehhhhccCCCceeehhhhhh
Confidence 38899999999999999876544 6699999888888888888666664
No 86
>cd05837 MSH6_like The PWWP domain is present in MSH6, a mismatch repair protein homologous to bacterial MutS. The PWWP domain of histone-lysine N-methyltransferase, also known as Nuclear SET domain-containing protein 3, is also included. Mutations in MSH6 have been linked to increased cancer susceptibility, particularly in hereditary nonpolyposis colorectal cancer in humans. The role of the PWWP domain in MSH6 is not clear; MSH6 orthologs found in S. cerevisiae, Caenorhabditis elegans and Arabidopsis thaliana lack the PWWP domain. Histone methyltransferases (HMTases) induce the posttranslational methylation of lysine residues in histones and play a role in apoptosis. In the HMTase Whistle, the PWWP domain is necessary for HMTase activity. The PWWP domain, named for a conserved Pro-Trp-Trp-Pro motif, is a small domain consisting of 100-150 amino acids. The PWWP domain is found in numerous proteins that are involved in cell division, growth and differentiation. Most PWWP-domain pro
Probab=64.82 E-value=6.9 Score=40.03 Aligned_cols=63 Identities=17% Similarity=0.374 Sum_probs=45.8
Q ss_pred EEEEEeccc-cccceeeeeccCCCccccccccCCCccEEEEEeccCCcchhhhhhccccccCCC
Q 000417 157 ALWVKWRGK-WQAGIRCARADWPLPTLKAKPTHDRKKYFVIFFPHTRNYSWADMLLVRSINEFP 219 (1534)
Q Consensus 157 ~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 219 (1534)
-+|.|=+|- |--|+-+...+=|..+.+..+....+.|.|.||..+.+|.||.---+.++.+.-
T Consensus 8 lVWaK~~g~PwWPa~V~~~~~~~~~~~~~~~~~~~~~~~V~FFG~~~~~aWv~~~~l~pf~~~~ 71 (110)
T cd05837 8 LVWAKVSGYPWWPCMVCSDPLLGTYTKTKRNKRKPRQYHVQFFGDNPERAWISEKSLKPFKGSK 71 (110)
T ss_pred EEEEeCCCCCCCCEEEecccccchhhhhhhccCCCCeEEEEEcCCCCCEEEecHHHccccCCch
Confidence 479999884 666666654444444444445555689999999999999999988888877654
No 87
>COG4049 Uncharacterized protein containing archaeal-type C2H2 Zn-finger [General function prediction only]
Probab=62.12 E-value=3.1 Score=37.35 Aligned_cols=35 Identities=20% Similarity=0.318 Sum_probs=27.8
Q ss_pred cccccCCCcccCCCCCcccCChhhHhhhhhcccCc
Q 000417 839 AGRSEDEKTHKCKICSQVFLHDQELGVHWMDNHKK 873 (1534)
Q Consensus 839 ~~~h~gekpykC~~CgK~F~sks~L~~H~~~~H~~ 873 (1534)
.+...||..++||-|++.|.....+.+|+...|.-
T Consensus 9 v~~RDGE~~lrCPRC~~~FR~~K~Y~RHVNKaH~~ 43 (65)
T COG4049 9 VRDRDGEEFLRCPRCGMVFRRRKDYIRHVNKAHGW 43 (65)
T ss_pred eeccCCceeeeCCchhHHHHHhHHHHHHhhHHhhh
Confidence 35567788889999999999999999997666653
No 88
>KOG2785 consensus C2H2-type Zn-finger protein [General function prediction only]
Probab=61.22 E-value=3.3 Score=50.05 Aligned_cols=172 Identities=12% Similarity=0.065 Sum_probs=98.8
Q ss_pred ccccCccCcccCChHHHHhHhhh--cccc--------cc---------------------cccccccccccCCCccCChH
Q 000417 881 GYACAICLDSFTNKKVLESHVQE--RHHV--------QF---------------------VEQCMLQQCIPCGSHFGNTE 929 (1534)
Q Consensus 881 pykC~~CgKsF~sks~L~~H~r~--Hh~e--------k~---------------------~~~~kpykC~~CgK~Fssk~ 929 (1534)
.|+|.-|...|.+...-+.|+++ |... .+ .....++.|..|.+.|.+..
T Consensus 3 ~ftC~tC~v~F~~ad~Qr~HyKSdWHRYNLKRkVA~lPPItaE~F~~k~~s~~~~~~~~~e~~~~~~~c~~c~k~~~s~~ 82 (390)
T KOG2785|consen 3 GFTCNTCNVEFDDADEQRAHYKSDWHRYNLKRKVASLPPITAEEFNEKVLSDDSEKEENLEEAESVVYCEACNKSFASPK 82 (390)
T ss_pred cceeeceeeeeccHHHHHHHhhhhHHHhhHHhHhhcCCCcCHHHHhHHHhhhhhhhhhhhhhcccceehHHhhccccChh
Confidence 58999999999999999999985 3211 00 01124789999999999999
Q ss_pred HHhhhhhcc-ccCcccchhhhhhccc-ccCCCCC-ccccCCCchhhhhhhhhcCCcceeeecccCCccCChhHHHHHHHh
Q 000417 930 ELWLHVQSV-HAIDFKMSEVAQQHNQ-SVGEDSP-KKLELGYSASVENHSENLGSIRKFICRFCGLKFDLLPDLGRHHQA 1006 (1534)
Q Consensus 930 ~Lk~H~~rv-H~~ef~C~~C~k~f~~-~~geKp~-~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKsF~sks~LkrHH~r 1006 (1534)
....|+... |... +..|.+ ..+...- .-..+.+... ..+.++ .+..+-..+........ +..
T Consensus 83 a~~~hl~Sk~h~~~------~~~~~r~~e~d~a~~~q~~~~~p~~-----l~~~~e---~e~~~~E~~~~~d~~~e-~~~ 147 (390)
T KOG2785|consen 83 AHENHLKSKKHVEN------LSNHQRSEEGDSAKISQLPSRRPSN-----LQNKGE---SELKWYEVDSDEDSSEE-EEE 147 (390)
T ss_pred hHHHHHHHhhcchh------hhhhhccccccchhhhhccccCccc-----cccCCC---cccchhhcccccccchh-hcc
Confidence 999995432 3211 111111 0000000 0000000000 001111 23333333333222222 111
Q ss_pred hcc------CC-CCCCCCCcccCCCCcccCCchhhhcccccccCCC-----------------------CccCCCCC---
Q 000417 1007 AHM------GP-NLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGLG-----------------------AVSYRIRN--- 1053 (1534)
Q Consensus 1007 tHt------ge-~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~gek-----------------------py~C~iCg--- 1053 (1534)
.-. .. .....-|-.|=+|++.|.+-..-..||..|||.. .|.|-.|+
T Consensus 148 dd~~Edi~~d~~~e~e~~Pt~CLfC~~~~k~~e~~~~HM~~~HgffIPdreYL~D~~GLl~YLgeKV~~~~~CL~CN~~~ 227 (390)
T KOG2785|consen 148 DDEEEDIEEDGDDEDELIPTDCLFCDKKSKSLEENLKHMFKEHGFFIPDREYLTDEKGLLKYLGEKVGIGFICLFCNELG 227 (390)
T ss_pred CcchhhhhhccchhcccCCcceeecCCCcccHHHHHHHHhhccCCcCCchHhhhchhHHHHHHHHHhccCceEEEecccc
Confidence 100 00 0111346889999999999999999999999862 27788888
Q ss_pred CcCCChHHHHhhcc
Q 000417 1054 RGAAGMKKRIQTLK 1067 (1534)
Q Consensus 1054 ksFs~~~~L~kH~K 1067 (1534)
+.|.++.+.++||.
T Consensus 228 ~~f~sleavr~HM~ 241 (390)
T KOG2785|consen 228 RPFSSLEAVRAHMR 241 (390)
T ss_pred CcccccHHHHHHHh
Confidence 99999999999986
No 89
>smart00451 ZnF_U1 U1-like zinc finger. Family of C2H2-type zinc fingers, present in matrin, U1 small nuclear ribonucleoprotein C and other RNA-binding proteins.
Probab=57.89 E-value=6.2 Score=31.45 Aligned_cols=25 Identities=28% Similarity=0.781 Sum_probs=17.3
Q ss_pred ccccCccCcccCChHHHHhHhhhcc
Q 000417 881 GYACAICLDSFTNKKVLESHVQERH 905 (1534)
Q Consensus 881 pykC~~CgKsF~sks~L~~H~r~Hh 905 (1534)
+|.|..|++.|.+...+..|++...
T Consensus 3 ~~~C~~C~~~~~~~~~~~~H~~gk~ 27 (35)
T smart00451 3 GFYCKLCNVTFTDEISVEAHLKGKK 27 (35)
T ss_pred CeEccccCCccCCHHHHHHHHChHH
Confidence 4667777777777777777766443
No 90
>KOG2893 consensus Zn finger protein [General function prediction only]
Probab=57.54 E-value=3.3 Score=46.85 Aligned_cols=47 Identities=23% Similarity=0.236 Sum_probs=34.6
Q ss_pred ecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhccc-ccccC
Q 000417 987 CRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRP-RFKKG 1043 (1534)
Q Consensus 987 C~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~-r~H~g 1043 (1534)
|-+|++.|....-|.+| ++ .|-|+|.+|.|...+--.|..|- .+|+.
T Consensus 13 cwycnrefddekiliqh-qk---------akhfkchichkkl~sgpglsihcmqvhke 60 (341)
T KOG2893|consen 13 CWYCNREFDDEKILIQH-QK---------AKHFKCHICHKKLFSGPGLSIHCMQVHKE 60 (341)
T ss_pred eeecccccchhhhhhhh-hh---------hccceeeeehhhhccCCCceeehhhhhhh
Confidence 78888888888888773 32 45688888888887777888775 55543
No 91
>KOG1337 consensus N-methyltransferase [General function prediction only]
Probab=56.30 E-value=8 Score=48.96 Aligned_cols=40 Identities=30% Similarity=0.368 Sum_probs=30.9
Q ss_pred ccccCCCCCceEEEEEEecccCCeeEEEEEEccCCCCCCeEEEEcCC
Q 000417 1466 FINHSCFPNLVNHQVLVESMDYQRAHIGLYASRDIAVGEELTYDYHY 1512 (1534)
Q Consensus 1466 FINHSC~PN~~~~~V~vd~~d~~~p~IafFA~RDI~aGEELT~DYg~ 1512 (1534)
+.||++++. ...++..| ..+-+++.++|.+|||+++.||.
T Consensus 239 ~~NH~~~~~----~~~~~~~d---~~~~l~~~~~v~~geevfi~YG~ 278 (472)
T KOG1337|consen 239 LLNHSPEVI----KAGYNQED---EAVELVAERDVSAGEEVFINYGP 278 (472)
T ss_pred hhccCchhc----cccccCCC---CcEEEEEeeeecCCCeEEEecCC
Confidence 579999992 22333323 37889999999999999999996
No 92
>PF13913 zf-C2HC_2: zinc-finger of a C2HC-type
Probab=55.07 E-value=9 Score=29.11 Aligned_cols=18 Identities=44% Similarity=0.805 Sum_probs=9.8
Q ss_pred ccCccCcccCChHHHHhHh
Q 000417 883 ACAICLDSFTNKKVLESHV 901 (1534)
Q Consensus 883 kC~~CgKsF~sks~L~~H~ 901 (1534)
.|+.|++.| ....|.+|+
T Consensus 4 ~C~~CgR~F-~~~~l~~H~ 21 (25)
T PF13913_consen 4 PCPICGRKF-NPDRLEKHE 21 (25)
T ss_pred cCCCCCCEE-CHHHHHHHH
Confidence 455555555 445555554
No 93
>smart00451 ZnF_U1 U1-like zinc finger. Family of C2H2-type zinc fingers, present in matrin, U1 small nuclear ribonucleoprotein C and other RNA-binding proteins.
Probab=54.51 E-value=4.6 Score=32.18 Aligned_cols=21 Identities=0% Similarity=-0.236 Sum_probs=12.4
Q ss_pred CcccCCCCcccCCchhhhccc
Q 000417 1018 PHKKGIRFYAYKLKSGRLSRP 1038 (1534)
Q Consensus 1018 pYkC~iC~K~F~sks~L~rH~ 1038 (1534)
+|.|++|++.|.....+..|+
T Consensus 3 ~~~C~~C~~~~~~~~~~~~H~ 23 (35)
T smart00451 3 GFYCKLCNVTFTDEISVEAHL 23 (35)
T ss_pred CeEccccCCccCCHHHHHHHH
Confidence 455666666666555555555
No 94
>PF13913 zf-C2HC_2: zinc-finger of a C2HC-type
Probab=51.27 E-value=10 Score=28.87 Aligned_cols=17 Identities=35% Similarity=0.682 Sum_probs=12.5
Q ss_pred eeecccCCccCChhHHHH
Q 000417 985 FICRFCGLKFDLLPDLGR 1002 (1534)
Q Consensus 985 ykC~~CgKsF~sks~Lkr 1002 (1534)
..|+.||+.| ....|.+
T Consensus 3 ~~C~~CgR~F-~~~~l~~ 19 (25)
T PF13913_consen 3 VPCPICGRKF-NPDRLEK 19 (25)
T ss_pred CcCCCCCCEE-CHHHHHH
Confidence 4688888888 6667777
No 95
>COG0068 HypF Hydrogenase maturation factor [Posttranslational modification, protein turnover, chaperones]
Probab=47.90 E-value=6.9 Score=50.89 Aligned_cols=13 Identities=0% Similarity=-0.048 Sum_probs=7.0
Q ss_pred ccchhhhhhcccc
Q 000417 943 FKMSEVAQQHNQS 955 (1534)
Q Consensus 943 f~C~~C~k~f~~~ 955 (1534)
-.|+.|.+.....
T Consensus 102 a~C~~Cl~Ei~dp 114 (750)
T COG0068 102 ATCEDCLEEIFDP 114 (750)
T ss_pred hhhHHHHHHhcCC
Confidence 3566666555443
No 96
>COG4049 Uncharacterized protein containing archaeal-type C2H2 Zn-finger [General function prediction only]
Probab=43.76 E-value=10 Score=34.17 Aligned_cols=33 Identities=27% Similarity=0.334 Sum_probs=26.8
Q ss_pred hcCCcceeeecccCCccCChhHHHHHHHhhccC
Q 000417 978 NLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMG 1010 (1534)
Q Consensus 978 tHtgeKpykC~~CgKsF~sks~LkrHH~rtHtg 1010 (1534)
.-.||.-++|+.||+.|....+..+|.-+.|.-
T Consensus 11 ~RDGE~~lrCPRC~~~FR~~K~Y~RHVNKaH~~ 43 (65)
T COG4049 11 DRDGEEFLRCPRCGMVFRRRKDYIRHVNKAHGW 43 (65)
T ss_pred ccCCceeeeCCchhHHHHHhHHHHHHhhHHhhh
Confidence 345777889999999999999999977777754
No 97
>KOG3813 consensus Uncharacterized conserved protein (tumor-suppressor AXUD1 in humans) [General function prediction only]
Probab=40.68 E-value=13 Score=46.60 Aligned_cols=19 Identities=42% Similarity=1.027 Sum_probs=16.6
Q ss_pred CCCcccCCCCcCCCCCCccc
Q 000417 1299 QLGCACANSTCFPETCDHVY 1318 (1534)
Q Consensus 1299 ~~GC~C~~~~C~p~~C~C~~ 1318 (1534)
-+||+|. +.|+|++|.|.+
T Consensus 307 eCGCsCr-~~CdPETCaCSq 325 (640)
T KOG3813|consen 307 ECGCSCR-GVCDPETCACSQ 325 (640)
T ss_pred hhCCccc-ceeChhhcchhc
Confidence 4899999 699999999964
No 98
>PF12013 DUF3505: Protein of unknown function (DUF3505); InterPro: IPR022698 This family of proteins is functionally uncharacterised. This protein is found in eukaryotes. Proteins in this family are typically between 247 to 1018 amino acids in length. This region contains two segments that are likely to be C2H2 zinc binding domains.
Probab=39.71 E-value=34 Score=34.68 Aligned_cols=27 Identities=15% Similarity=-0.070 Sum_probs=19.5
Q ss_pred CCccc----CCCCcccCCchhhhcccccccC
Q 000417 1017 RPHKK----GIRFYAYKLKSGRLSRPRFKKG 1043 (1534)
Q Consensus 1017 KpYkC----~iC~K~F~sks~L~rH~r~H~g 1043 (1534)
..|.| ..|++.+.+...+++|.+.+||
T Consensus 79 ~G~~C~~~~~~C~y~~~~~~~m~~H~~~~Hg 109 (109)
T PF12013_consen 79 DGYRCQCDPPHCGYITRSKKTMRKHWRKEHG 109 (109)
T ss_pred CCeeeecCCCCCCcEeccHHHHHHHHHHhcC
Confidence 34777 7777777777777777776654
No 99
>smart00293 PWWP domain with conserved PWWP motif. conservation of Pro-Trp-Trp-Pro residues
Probab=39.58 E-value=32 Score=31.62 Aligned_cols=56 Identities=20% Similarity=0.433 Sum_probs=38.5
Q ss_pred EEEEEecc-ccccceeeeeccCCCccccccccCCCccEEEEEeccCCcchhhhhhccccc
Q 000417 157 ALWVKWRG-KWQAGIRCARADWPLPTLKAKPTHDRKKYFVIFFPHTRNYSWADMLLVRSI 215 (1534)
Q Consensus 157 ~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 215 (1534)
-+|.|=+| -|--|+-+...+-|...++ +.-....|.|.||.. .+|.|++--.+.++
T Consensus 6 lVwaK~~G~p~WPa~V~~~~~~~~~~~~--~~~~~~~~~V~Ffg~-~~~awv~~~~l~p~ 62 (63)
T smart00293 6 LVWAKMKGFPWWPALVVSPKETPDNIRK--RKRFENLYPVLFFGD-KDTAWISSSKLFPL 62 (63)
T ss_pred EEEEECCCCCCCCeEEcCcccCChhHhh--ccCCCCEEEEEEeCC-CCEEEECccceeeC
Confidence 37999999 7777777766665554332 334456788888875 55699987766554
No 100
>PF00855 PWWP: PWWP domain; InterPro: IPR000313 Upon characterisation of WHSC1, a gene mapping to the Wolf-Hirschhornsyndrome critical region and at its C terminus similar to the Drosophila melanogaster ASH1/trithorax group proteins, a novel protein domain designated PWWP domain was identified []. The PWWP domain is named after a conserved Pro-Trp-Trp-Pro motif. It is present in proteins of nuclear origin and plays a role in cell growth and differentiation. Due to its position, the composition of amino acids close to the PWWP motif and the pattern of other domains present it has been suggested that the domain is involved in protein-protein interactions [].; PDB: 3LYI_B 2L89_A 2NLU_A 1RI0_A 1KHC_A 3QKJ_C 2DAQ_A 1N27_A 3PFS_B 3QJ6_A ....
Probab=38.32 E-value=31 Score=32.93 Aligned_cols=56 Identities=23% Similarity=0.577 Sum_probs=38.4
Q ss_pred EEEEEecc-ccccceeeeeccCCCccccccccCCCccEEEEEeccCCcchhhhhhccccccCCC
Q 000417 157 ALWVKWRG-KWQAGIRCARADWPLPTLKAKPTHDRKKYFVIFFPHTRNYSWADMLLVRSINEFP 219 (1534)
Q Consensus 157 ~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 219 (1534)
-+|+|=+| -|=-|+=|...+.+- + ......|.|.||... +|.|++.-.|.+.+++-
T Consensus 6 lVWaK~~g~pwWPa~V~~~~~~~~-----~-~~~~~~~~V~Ffg~~-~~~wv~~~~i~~f~~~~ 62 (86)
T PF00855_consen 6 LVWAKLKGYPWWPARVCDPDEKSK-----K-KRKDGHVLVRFFGDN-DYAWVKPSNIKPFSEFK 62 (86)
T ss_dssp EEEEEETTSEEEEEEEEECCHCTS-----C-SSSSTEEEEEETTTT-EEEEEEGGGEEECCHHH
T ss_pred EEEEEeCCCCCCceEEeecccccc-----c-CCCCCEEEEEecCCC-CEEEECHHHhhChhhhH
Confidence 48999987 355666666664443 1 334466777777766 99999998888877544
No 101
>cd00350 rubredoxin_like Rubredoxin_like; nonheme iron binding domain containing a [Fe(SCys)4] center. The family includes rubredoxins, a small electron transfer protein, and a slightly smaller modular rubredoxin domain present in rubrerythrin and nigerythrin and detected either N- or C-terminal to such proteins as flavin reductase, NAD(P)H-nitrite reductase, and ferredoxin-thioredoxin reductase. In rubredoxin, the iron atom is coordinated by four cysteine residues (Fe(S-Cys)4), but iron can also be replaced by cobalt, nickel or zinc and believed to be involved in electron transfer. Rubrerythrins and nigerythrins are small homodimeric proteins, generally consisting of 2 domains: a rubredoxin domain C-terminal to a non-sulfur, oxo-bridged diiron site in the N-terminal rubrerythrin domain. Rubrerythrins and nigerythrins have putative peroxide activity.
Probab=37.12 E-value=23 Score=28.64 Aligned_cols=10 Identities=0% Similarity=-0.114 Sum_probs=4.9
Q ss_pred CCccCCCCCC
Q 000417 1045 GAVSYRIRNR 1054 (1534)
Q Consensus 1045 kpy~C~iCgk 1054 (1534)
.+..|++|+.
T Consensus 16 ~~~~CP~Cg~ 25 (33)
T cd00350 16 APWVCPVCGA 25 (33)
T ss_pred CCCcCcCCCC
Confidence 3445555543
No 102
>COG1198 PriA Primosomal protein N' (replication factor Y) - superfamily II helicase [DNA replication, recombination, and repair]
Probab=36.76 E-value=17 Score=48.35 Aligned_cols=42 Identities=21% Similarity=0.180 Sum_probs=25.9
Q ss_pred CCCccccchhhhchhhhhhhhhhhhh-cCCCCCccccccccccc
Q 000417 1112 PNSHEILSMARLACCKVSLKASLEEK-YGALPENICLKAAKLCS 1154 (1534)
Q Consensus 1112 Psn~dIls~a~s~CcK~~l~asL~~k-~g~lpe~l~lkaakLcs 1154 (1534)
|.+..|..+-.. =.-+|..+.|+.+ -..+||--++-+....+
T Consensus 603 P~hp~i~~~~~~-dy~~F~~~El~~Rk~~~~PPf~~l~~v~~~~ 645 (730)
T COG1198 603 PDHPAIQALKRG-DYEAFYEQELAERKELGLPPFSRLAAVIASA 645 (730)
T ss_pred CCcHHHHHHHhc-CHHHHHHHHHHHHHhcCCCChhhheeeEecC
Confidence 544444444333 2335888888877 68889888877554433
No 103
>PF09538 FYDLN_acid: Protein of unknown function (FYDLN_acid); InterPro: IPR012644 Members of this family are bacterial proteins with a conserved motif [KR]FYDLN, sometimes flanked by a pair of CXXC motifs, followed by a long region of low complexity sequence in which roughly half the residues are Asp and Glu, including multiple runs of five or more acidic residues. The function of members of this family is unknown.
Probab=36.16 E-value=18 Score=37.09 Aligned_cols=30 Identities=23% Similarity=0.222 Sum_probs=18.7
Q ss_pred eeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCc
Q 000417 985 FICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLK 1031 (1534)
Q Consensus 985 ykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sk 1031 (1534)
..|+.||++|.- |+ ..|-.|++||..|.-.
T Consensus 10 R~Cp~CG~kFYD---Ln--------------k~PivCP~CG~~~~~~ 39 (108)
T PF09538_consen 10 RTCPSCGAKFYD---LN--------------KDPIVCPKCGTEFPPE 39 (108)
T ss_pred ccCCCCcchhcc---CC--------------CCCccCCCCCCccCcc
Confidence 467777777753 21 2466677777777655
No 104
>TIGR02098 MJ0042_CXXC MJ0042 family finger-like domain. This domain contains a CXXCX(19)CXXC motif suggestive of both zinc fingers and thioredoxin, usually found at the N-terminus of prokaryotic proteins. One partially characterized gene, agmX, is among a large set in Myxococcus whose interruption affects adventurous gliding motility.
Probab=35.21 E-value=19 Score=29.60 Aligned_cols=34 Identities=12% Similarity=0.123 Sum_probs=17.7
Q ss_pred eeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccC
Q 000417 985 FICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYK 1029 (1534)
Q Consensus 985 ykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~ 1029 (1534)
++|+.|+..|.-..+... .. .....|+.|+..|.
T Consensus 3 ~~CP~C~~~~~v~~~~~~------~~-----~~~v~C~~C~~~~~ 36 (38)
T TIGR02098 3 IQCPNCKTSFRVVDSQLG------AN-----GGKVRCGKCGHVWY 36 (38)
T ss_pred EECCCCCCEEEeCHHHcC------CC-----CCEEECCCCCCEEE
Confidence 456667666655544321 01 12456666666553
No 105
>cd05838 WHSC1_related The PWWP domain was first identified in the WHSC1 (Wolf-Hirschhorn syndrome candidate 1) protein, a protein implicated in Wolf-Hirschhorn syndrome (WHS). When translocated, WHSC1 plays a role in lymphoid multiple myeloma (MM) disease, also known as plasmacytoma. WHCS1 proteins typically contain two copies of the PWWP domain. The PWWP domain, named for a conserved Pro-Trp-Trp-Pro motif, is a small domain consisting of 100-150 amino acids. The PWWP domain is found in numerous proteins that are involved in cell division, growth and differentiation. Most PWWP-domain proteins seem to be nuclear, often DNA-binding, proteins that function as transcription factors regulating a variety of developmental processes.
Probab=35.04 E-value=30 Score=34.59 Aligned_cols=54 Identities=26% Similarity=0.543 Sum_probs=34.0
Q ss_pred EEEEecc-ccccceeeeeccCCCccccccccCCCccEEEEEeccCCcchhhhhhcccc
Q 000417 158 LWVKWRG-KWQAGIRCARADWPLPTLKAKPTHDRKKYFVIFFPHTRNYSWADMLLVRS 214 (1534)
Q Consensus 158 ~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 214 (1534)
+|+|-+| -|=-|+-|-..+=|-..+..+ +....|.|.|| .+++|.|++--.|-+
T Consensus 7 VWaK~~g~pwWPa~V~~~~~~p~~~~~~~--~~~~~~~V~Ff-gs~~y~Wv~~~~l~p 61 (95)
T cd05838 7 VWAKLGNFRWWPAIICDPREVPPNIQVLR--HCIGEFCVMFF-GTHDYYWVHRGRVFP 61 (95)
T ss_pred EEEECCCCCCCCeEEcChhhcChhHhhcc--CCCCeEEEEEe-CCCCEEEeccccccc
Confidence 7999998 455666665543333222211 23356888888 589999999744443
No 106
>TIGR00373 conserved hypothetical protein TIGR00373. This family of proteins is, so far, restricted to archaeal genomes. The family appears to be distantly related to the N-terminal region of the eukaryotic transcription initiation factor IIE alpha chain.
Probab=34.47 E-value=26 Score=38.18 Aligned_cols=39 Identities=13% Similarity=-0.030 Sum_probs=25.4
Q ss_pred hhhhhcCCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcc
Q 000417 974 NHSENLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYA 1027 (1534)
Q Consensus 974 ~HlrtHtgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~ 1027 (1534)
.-+.......-|.|+.|+..|+...++.. .|.|+.||..
T Consensus 99 ~~l~~e~~~~~Y~Cp~c~~r~tf~eA~~~---------------~F~Cp~Cg~~ 137 (158)
T TIGR00373 99 EKLEFETNNMFFICPNMCVRFTFNEAMEL---------------NFTCPRCGAM 137 (158)
T ss_pred HHHhhccCCCeEECCCCCcEeeHHHHHHc---------------CCcCCCCCCE
Confidence 33344445566788888888777766632 4778888754
No 107
>PF09986 DUF2225: Uncharacterized protein conserved in bacteria (DUF2225); InterPro: IPR018708 This conserved bacterial family has no known function.
Probab=34.33 E-value=23 Score=40.47 Aligned_cols=42 Identities=17% Similarity=0.060 Sum_probs=25.2
Q ss_pred CCCcccCCCCcccCCchhhhccccc---c-------cCCCC-----ccCCCCCCcCC
Q 000417 1016 SRPHKKGIRFYAYKLKSGRLSRPRF---K-------KGLGA-----VSYRIRNRGAA 1057 (1534)
Q Consensus 1016 eKpYkC~iC~K~F~sks~L~rH~r~---H-------~gekp-----y~C~iCgksFs 1057 (1534)
.+.+.||+|++.|.++.-+....|. . .+..| ..|+.||.+|.
T Consensus 3 ~k~~~CPvC~~~F~~~~vrs~~~r~~~~d~D~~~~Y~~vnP~~Y~V~vCP~CgyA~~ 59 (214)
T PF09986_consen 3 DKKITCPVCGKEFKTKKVRSGKIRVIRRDSDFCPRYKGVNPLFYEVWVCPHCGYAAF 59 (214)
T ss_pred CCceECCCCCCeeeeeEEEcCCceEeeecCCCccccCCCCCeeeeEEECCCCCCccc
Confidence 3556677777777766555554432 1 12233 47999998875
No 108
>PF13891 zf-C3Hc3H: Potential DNA-binding domain
Probab=33.76 E-value=14 Score=34.46 Aligned_cols=24 Identities=38% Similarity=0.663 Sum_probs=21.0
Q ss_pred eecCCcccccccCCCcccccCCCC
Q 000417 587 TVLGTRCKHRALYGSSFCKKHRPR 610 (1534)
Q Consensus 587 ~~~~~~c~~~~~~~~~~c~k~~~~ 610 (1534)
+..|+.|+.+++||+.||-+|-..
T Consensus 3 ~~~~~~C~~~~lp~~~yC~~HIl~ 26 (65)
T PF13891_consen 3 TYSGRGCSQPALPGSKYCIRHILE 26 (65)
T ss_pred CCCCCCcCcccCchhhHHHHHhcc
Confidence 567899999999999999999743
No 109
>smart00531 TFIIE Transcription initiation factor IIE.
Probab=33.20 E-value=31 Score=37.03 Aligned_cols=39 Identities=13% Similarity=0.059 Sum_probs=23.5
Q ss_pred CCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCccc
Q 000417 980 GSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAY 1028 (1534)
Q Consensus 980 tgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F 1028 (1534)
....-|.|+.|+..|.....+.. .+. ...|.|+.|+...
T Consensus 95 ~~~~~Y~Cp~C~~~y~~~ea~~~----~d~------~~~f~Cp~Cg~~l 133 (147)
T smart00531 95 TNNAYYKCPNCQSKYTFLEANQL----LDM------DGTFTCPRCGEEL 133 (147)
T ss_pred cCCcEEECcCCCCEeeHHHHHHh----cCC------CCcEECCCCCCEE
Confidence 34456888888888876544422 011 2248888888654
No 110
>smart00391 MBD Methyl-CpG binding domain. Methyl-CpG binding domain, also known as the TAM (TTF-IIP5, ARBP, MeCP1) domain
Probab=32.20 E-value=16 Score=35.25 Aligned_cols=25 Identities=4% Similarity=-0.181 Sum_probs=21.4
Q ss_pred cccccCCCCcCCc-cccccceeeecc
Q 000417 1195 IRSSDSSDFVNNQ-WEVDECHCIIDS 1219 (1534)
Q Consensus 1195 ~k~v~~~~~~~~~-~~~~e~~~~l~~ 1219 (1534)
+..|.|..|+|.. +.+.|++.||..
T Consensus 27 ~~dV~Y~sP~GkklRs~~ev~~YL~~ 52 (77)
T smart00391 27 KFDVYYISPCGKKLRSKSELARYLHK 52 (77)
T ss_pred cccEEEECCCCCeeeCHHHHHHHHHh
Confidence 4568899999999 999999988764
No 111
>PF14353 CpXC: CpXC protein
Probab=31.91 E-value=29 Score=36.16 Aligned_cols=49 Identities=20% Similarity=0.247 Sum_probs=32.1
Q ss_pred eecccCCccCC----------hhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccc
Q 000417 986 ICRFCGLKFDL----------LPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFK 1041 (1534)
Q Consensus 986 kC~~CgKsF~s----------ks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H 1041 (1534)
+|+.|+..|.. ...|+. ++-.|. --.|.|+.||+.|.-...+..|-..|
T Consensus 3 tCP~C~~~~~~~v~~~I~~~~~p~l~e---~il~g~----l~~~~CP~Cg~~~~~~~p~lY~D~~~ 61 (128)
T PF14353_consen 3 TCPHCGHEFEFEVWTSINADEDPELKE---KILDGS----LFSFTCPSCGHKFRLEYPLLYHDPEK 61 (128)
T ss_pred CCCCCCCeeEEEEEeEEcCcCCHHHHH---HHHcCC----cCEEECCCCCCceecCCCEEEEcCCC
Confidence 57777777653 233333 233342 34688999999999888888887555
No 112
>PF09986 DUF2225: Uncharacterized protein conserved in bacteria (DUF2225); InterPro: IPR018708 This conserved bacterial family has no known function.
Probab=31.68 E-value=14 Score=42.22 Aligned_cols=13 Identities=23% Similarity=0.317 Sum_probs=10.2
Q ss_pred cccccCCCccCCh
Q 000417 916 QQCIPCGSHFGNT 928 (1534)
Q Consensus 916 ykC~~CgK~Fssk 928 (1534)
..|+.||.+|...
T Consensus 49 ~vCP~CgyA~~~~ 61 (214)
T PF09986_consen 49 WVCPHCGYAAFEE 61 (214)
T ss_pred EECCCCCCccccc
Confidence 3699999888754
No 113
>KOG2186 consensus Cell growth-regulating nucleolar protein [Cell cycle control, cell division, chromosome partitioning]
Probab=31.31 E-value=23 Score=41.04 Aligned_cols=44 Identities=27% Similarity=0.616 Sum_probs=30.6
Q ss_pred cccCccCcccCChHHHHhHhhhcccccccccccccccccCCCccCChHHHhhh
Q 000417 882 YACAICLDSFTNKKVLESHVQERHHVQFVEQCMLQQCIPCGSHFGNTEELWLH 934 (1534)
Q Consensus 882 ykC~~CgKsF~sks~L~~H~r~Hh~ek~~~~~kpykC~~CgK~Fssk~~Lk~H 934 (1534)
|.|..||.+.. +..+.+|+..-++. -|.|-.|++.|.. ..+..|
T Consensus 4 FtCnvCgEsvK-Kp~vekH~srCrn~-------~fSCIDC~k~F~~-~sYknH 47 (276)
T KOG2186|consen 4 FTCNVCGESVK-KPQVEKHMSRCRNA-------YFSCIDCGKTFER-VSYKNH 47 (276)
T ss_pred Eehhhhhhhcc-ccchHHHHHhccCC-------eeEEeeccccccc-chhhhh
Confidence 67888887665 44566687766663 3668888888877 566666
No 114
>PF09538 FYDLN_acid: Protein of unknown function (FYDLN_acid); InterPro: IPR012644 Members of this family are bacterial proteins with a conserved motif [KR]FYDLN, sometimes flanked by a pair of CXXC motifs, followed by a long region of low complexity sequence in which roughly half the residues are Asp and Glu, including multiple runs of five or more acidic residues. The function of members of this family is unknown.
Probab=30.37 E-value=33 Score=35.25 Aligned_cols=31 Identities=19% Similarity=0.507 Sum_probs=19.7
Q ss_pred cccCCCCCcccCChhhHhhhhhcccCccccccCCccccCccCcccCCh
Q 000417 847 THKCKICSQVFLHDQELGVHWMDNHKKEAQWLFRGYACAICLDSFTNK 894 (1534)
Q Consensus 847 pykC~~CgK~F~sks~L~~H~~~~H~~e~~~~ekpykC~~CgKsF~sk 894 (1534)
...|+.||+.|.... . .|..|+.||..|.-.
T Consensus 9 KR~Cp~CG~kFYDLn------------k-----~PivCP~CG~~~~~~ 39 (108)
T PF09538_consen 9 KRTCPSCGAKFYDLN------------K-----DPIVCPKCGTEFPPE 39 (108)
T ss_pred cccCCCCcchhccCC------------C-----CCccCCCCCCccCcc
Confidence 456777777776421 1 456677777777655
No 115
>PRK06266 transcription initiation factor E subunit alpha; Validated
Probab=29.71 E-value=31 Score=38.34 Aligned_cols=34 Identities=12% Similarity=0.117 Sum_probs=21.7
Q ss_pred CCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCccc
Q 000417 980 GSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAY 1028 (1534)
Q Consensus 980 tgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F 1028 (1534)
....-|.|+.|++.|+...++. ..|.|+.||...
T Consensus 113 ~~~~~Y~Cp~C~~rytf~eA~~---------------~~F~Cp~Cg~~L 146 (178)
T PRK06266 113 ENNMFFFCPNCHIRFTFDEAME---------------YGFRCPQCGEML 146 (178)
T ss_pred cCCCEEECCCCCcEEeHHHHhh---------------cCCcCCCCCCCC
Confidence 3345677777777777666552 247777777543
No 116
>PF11722 zf-TRM13_CCCH: CCCH zinc finger in TRM13 protein; InterPro: IPR021721 This domain is found at the N terminus of TRM13 methyltransferase proteins. It is presumed to be a zinc binding domain. ; GO: 0008168 methyltransferase activity
Probab=29.41 E-value=30 Score=27.91 Aligned_cols=21 Identities=38% Similarity=0.634 Sum_probs=18.4
Q ss_pred cCCcccccccCCCcccccCCC
Q 000417 589 LGTRCKHRALYGSSFCKKHRP 609 (1534)
Q Consensus 589 ~~~~c~~~~~~~~~~c~k~~~ 609 (1534)
-.+.|+-...+|+.||.-|.|
T Consensus 11 K~R~C~m~~~~g~~fC~~H~~ 31 (31)
T PF11722_consen 11 KKRFCKMTRKPGSRFCGEHMP 31 (31)
T ss_pred cccccCCeecCcCCccccCCC
Confidence 357899999999999999975
No 117
>KOG2461 consensus Transcription factor BLIMP-1/PRDI-BF1, contains C2H2-type Zn-finger and SET domains [Transcription]
Probab=27.65 E-value=73 Score=39.78 Aligned_cols=81 Identities=0% Similarity=-0.295 Sum_probs=51.0
Q ss_pred CchhhhhhhhhcCCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCchhhhcccccccCCCCc
Q 000417 968 YSASVENHSENLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLKSGRLSRPRFKKGLGAV 1047 (1534)
Q Consensus 968 k~~sLk~HlrtHtgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sks~L~rH~r~H~gekpy 1047 (1534)
..+....|...|++..+..++++.+.+.....+.. +...|.+ +.++.+..+...+.....+..+..+|+....+
T Consensus 315 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~~~-----~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 388 (396)
T KOG2461|consen 315 KQLVLDQSEVPATVSVWTGETIPVRTPAGQLIYTQ-SHSMEVA-----EPTDMAPNQIWKIYHTGVLGFLIITTDESECN 388 (396)
T ss_pred cccccccccccccccccCcCcccccccccccchhh-hhhcccC-----CCCcccccccccceeccccceeeeeccccccc
Confidence 33445666666777777777777777777777777 5566666 55566655555555555666666666666666
Q ss_pred cCCCCCC
Q 000417 1048 SYRIRNR 1054 (1534)
Q Consensus 1048 ~C~iCgk 1054 (1534)
.+..|++
T Consensus 389 ~~~~~~~ 395 (396)
T KOG2461|consen 389 NMSFVCK 395 (396)
T ss_pred cccccCC
Confidence 6555543
No 118
>cd05839 BR140_related The PWWP domain is found in the BR140 family, which includes peregrin and BR140-like proteins 1 and 2. BR140 is the only family to contain the PWWP domain at the C terminus, with PHD and bromo domains in the N-terminal region. In myeloid leukemias, BR140 is disrupted by chromosomal translocations, similar to translocations of WHSC1 in lymphoid multiple myeloma. The PWWP domain, named for a conserved Pro-Trp-Trp-Pro motif, is a small domain consisting of 100-150 amino acids. The PWWP domain is found in numerous proteins that are involved in cell division, growth and differentiation. Most PWWP-domain proteins seem to be nuclear, often DNA-binding proteins, that function as transcription factors regulating a variety of developmental processes.
Probab=27.36 E-value=92 Score=32.30 Aligned_cols=61 Identities=21% Similarity=0.421 Sum_probs=40.7
Q ss_pred EEEEEeccc-cccceeeeec----cC-----CCcccc----ccccCCCccEEEEEeccCCcchhhhhhccccccC
Q 000417 157 ALWVKWRGK-WQAGIRCARA----DW-----PLPTLK----AKPTHDRKKYFVIFFPHTRNYSWADMLLVRSINE 217 (1534)
Q Consensus 157 ~~~~~~~~~-~~~~~~~~~~----~~-----~~~~~~----~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 217 (1534)
-||.|-+|- |.-|+-.-.. .. |++-|+ .+.-.+.+.|+|-||=.+++|.|++---+.+..+
T Consensus 6 lVwaK~~g~P~wPa~iidp~~~~~~~~~~~~p~~~l~~~~~~~~~~~~~~~lV~FFd~~~s~~Wv~~~~l~pl~~ 80 (111)
T cd05839 6 LVWAKCRGYPSYPALIIDPKMPRDGVFHNGVPPDVLTLGEARAQNADERLYLVLFFDNKRTWQWLPGDKLEPLGV 80 (111)
T ss_pred EeeeeecCCCCCCeEeeCCCCCCcccccCCCCchhhhHHHHHhccCCCcEEEEEEecCCCcceecCHHHCccccc
Confidence 379998883 6666554422 11 112222 2334678889999999999999999887776654
No 119
>smart00834 CxxC_CXXC_SSSS Putative regulatory protein. CxxC_CXXC_SSSS represents a region of about 41 amino acids found in a number of small proteins in a wide range of bacteria. The region usually begins with the initiator Met and contains two CxxC motifs separated by 17 amino acids. One protein in this entry has been noted as a putative regulatory protein, designated FmdB. Most proteins in this entry have a C-terminal region containing highly degenerate sequence.
Probab=27.19 E-value=20 Score=29.63 Aligned_cols=11 Identities=36% Similarity=1.093 Sum_probs=6.6
Q ss_pred eeecccCCccC
Q 000417 985 FICRFCGLKFD 995 (1534)
Q Consensus 985 ykC~~CgKsF~ 995 (1534)
|+|..||..|.
T Consensus 6 y~C~~Cg~~fe 16 (41)
T smart00834 6 YRCEDCGHTFE 16 (41)
T ss_pred EEcCCCCCEEE
Confidence 56666666654
No 120
>PHA00626 hypothetical protein
Probab=26.81 E-value=22 Score=32.28 Aligned_cols=13 Identities=8% Similarity=-0.455 Sum_probs=8.5
Q ss_pred CcccCCCCcccCC
Q 000417 1018 PHKKGIRFYAYKL 1030 (1534)
Q Consensus 1018 pYkC~iC~K~F~s 1030 (1534)
.|+|+.|++.|+.
T Consensus 23 rYkCkdCGY~ft~ 35 (59)
T PHA00626 23 DYVCCDCGYNDSK 35 (59)
T ss_pred ceEcCCCCCeech
Confidence 5677777766654
No 121
>PF06524 NOA36: NOA36 protein; InterPro: IPR010531 This family consists of several NOA36 proteins which contain 29 highly conserved cysteine residues. The function of this protein is unknown.; GO: 0008270 zinc ion binding, 0005634 nucleus
Probab=25.82 E-value=40 Score=39.24 Aligned_cols=11 Identities=18% Similarity=0.643 Sum_probs=6.6
Q ss_pred CcccCCCCCcc
Q 000417 846 KTHKCKICSQV 856 (1534)
Q Consensus 846 kpykC~~CgK~ 856 (1534)
+.-.|..|||.
T Consensus 62 rlp~Ca~Cgk~ 72 (314)
T PF06524_consen 62 RLPMCAHCGKT 72 (314)
T ss_pred cCchhhhcCCe
Confidence 44456777764
No 122
>TIGR02605 CxxC_CxxC_SSSS putative regulatory protein, FmdB family. This model represents a region of about 50 amino acids found in a number of small proteins in a wide range of bacteria. The region begins usually with the initiator Met and contains two CxxC motifs separated by 17 amino acids. One member of this family is has been noted as a putative regulatory protein, designated FmdB (PubMed:8841393). Most members of this family have a C-terminal region containing highly degenerate sequence, such as SSTSESTKSSGSSGSSGSSESKASGSTEKSTSSTTAAAAV in Mycobacterium tuberculosis and VAVGGSAPAPSPAPRAGGGGGGCCGGGCCG in Streptomyces avermitilis. These low complexity regions, which are not included in the model, resemble low-complexity C-terminal regions of some heterocycle-containing bacteriocin precursors.
Probab=25.37 E-value=24 Score=30.89 Aligned_cols=11 Identities=36% Similarity=1.219 Sum_probs=5.9
Q ss_pred eeecccCCccC
Q 000417 985 FICRFCGLKFD 995 (1534)
Q Consensus 985 ykC~~CgKsF~ 995 (1534)
|+|..||..|.
T Consensus 6 y~C~~Cg~~fe 16 (52)
T TIGR02605 6 YRCTACGHRFE 16 (52)
T ss_pred EEeCCCCCEeE
Confidence 55555555554
No 123
>PF09723 Zn-ribbon_8: Zinc ribbon domain; InterPro: IPR013429 This entry represents a region of about 41 amino acids found in a number of small proteins in a wide range of bacteria. The region usually begins with the initiator Met and contains two CxxC motifs separated by 17 amino acids. One protein in this entry has been noted as a putative regulatory protein, designated FmdB []. Most proteins in this entry have a C-terminal region containing highly degenerate sequence.
Probab=25.32 E-value=21 Score=30.36 Aligned_cols=12 Identities=33% Similarity=1.099 Sum_probs=6.9
Q ss_pred eeecccCCccCC
Q 000417 985 FICRFCGLKFDL 996 (1534)
Q Consensus 985 ykC~~CgKsF~s 996 (1534)
|+|..||..|..
T Consensus 6 y~C~~Cg~~fe~ 17 (42)
T PF09723_consen 6 YRCEECGHEFEV 17 (42)
T ss_pred EEeCCCCCEEEE
Confidence 556666666543
No 124
>PRK00464 nrdR transcriptional regulator NrdR; Validated
Probab=25.31 E-value=26 Score=38.12 Aligned_cols=40 Identities=15% Similarity=0.080 Sum_probs=0.0
Q ss_pred eeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCC
Q 000417 985 FICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKL 1030 (1534)
Q Consensus 985 ykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~s 1030 (1534)
++||+||-.+..-.+=.- ..+.....+.|+|+.||++|.+
T Consensus 1 m~cp~c~~~~~~~~~s~~------~~~~~~~~~~~~c~~c~~~f~~ 40 (154)
T PRK00464 1 MRCPFCGHPDTRVIDSRP------AEDGNAIRRRRECLACGKRFTT 40 (154)
T ss_pred CcCCCCCCCCCEeEeccc------cCCCCceeeeeeccccCCcceE
No 125
>PF12013 DUF3505: Protein of unknown function (DUF3505); InterPro: IPR022698 This family of proteins is functionally uncharacterised. This protein is found in eukaryotes. Proteins in this family are typically between 247 to 1018 amino acids in length. This region contains two segments that are likely to be C2H2 zinc binding domains.
Probab=25.25 E-value=61 Score=32.87 Aligned_cols=24 Identities=21% Similarity=0.400 Sum_probs=21.3
Q ss_pred ccc----ccCCCccCChHHHhhhhhccc
Q 000417 916 QQC----IPCGSHFGNTEELWLHVQSVH 939 (1534)
Q Consensus 916 ykC----~~CgK~Fssk~~Lk~H~~rvH 939 (1534)
|.| ..|+..+.+...+.+|++..|
T Consensus 81 ~~C~~~~~~C~y~~~~~~~m~~H~~~~H 108 (109)
T PF12013_consen 81 YRCQCDPPHCGYITRSKKTMRKHWRKEH 108 (109)
T ss_pred eeeecCCCCCCcEeccHHHHHHHHHHhc
Confidence 789 999999999999999977666
No 126
>TIGR02300 FYDLN_acid conserved hypothetical protein TIGR02300. Members of this family are bacterial proteins with a conserved motif [KR]FYDLN, sometimes flanked by a pair of CXXC motifs, followed by a long region of low complexity sequence in which roughly half the residues are Asp and Glu, including multiple runs of five or more acidic residues. The function of members of this family is unknown.
Probab=24.80 E-value=43 Score=35.32 Aligned_cols=30 Identities=27% Similarity=0.253 Sum_probs=18.4
Q ss_pred eeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCCc
Q 000417 985 FICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKLK 1031 (1534)
Q Consensus 985 ykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~sk 1031 (1534)
..|+.||++|.- |. ..|-.|++||..|.-.
T Consensus 10 r~Cp~cg~kFYD---Ln--------------k~p~vcP~cg~~~~~~ 39 (129)
T TIGR02300 10 RICPNTGSKFYD---LN--------------RRPAVSPYTGEQFPPE 39 (129)
T ss_pred ccCCCcCccccc---cC--------------CCCccCCCcCCccCcc
Confidence 467777777753 21 2466777777766554
No 127
>PF08879 WRC: WRC; InterPro: IPR014977 WRC is named after the conserved Trp-Arg-Cys motif, it contains two distinctive features: a putative nuclear localisation signal and a zinc-finger motif (C3H). It is suggested that WRC functions in DNA binding []. ; GO: 0005515 protein binding
Probab=24.77 E-value=26 Score=30.78 Aligned_cols=20 Identities=50% Similarity=0.865 Sum_probs=18.2
Q ss_pred cCCcccccccCCCcccccCC
Q 000417 589 LGTRCKHRALYGSSFCKKHR 608 (1534)
Q Consensus 589 ~~~~c~~~~~~~~~~c~k~~ 608 (1534)
-|=||+.++++|.++|.+|.
T Consensus 13 K~WrC~~~a~~g~~~Ce~H~ 32 (46)
T PF08879_consen 13 KGWRCSRRALPGYSLCEHHL 32 (46)
T ss_pred CccccCCccCCCccHHHHHH
Confidence 46699999999999999997
No 128
>COG1997 RPL43A Ribosomal protein L37AE/L43A [Translation, ribosomal structure and biogenesis]
Probab=24.06 E-value=31 Score=34.09 Aligned_cols=32 Identities=22% Similarity=0.257 Sum_probs=18.8
Q ss_pred ceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcccCC
Q 000417 983 RKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYAYKL 1030 (1534)
Q Consensus 983 KpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~F~s 1030 (1534)
.+|.|+.|++.- +.|+-+| -+.|..|++.|.-
T Consensus 34 ~~~~Cp~C~~~~---------VkR~a~G-------IW~C~kCg~~fAG 65 (89)
T COG1997 34 AKHVCPFCGRTT---------VKRIATG-------IWKCRKCGAKFAG 65 (89)
T ss_pred cCCcCCCCCCcc---------eeeeccC-------eEEcCCCCCeecc
Confidence 356777776651 3344444 5677777776654
No 129
>PF02892 zf-BED: BED zinc finger; InterPro: IPR003656 Zinc finger (Znf) domains are relatively small protein motifs which contain multiple finger-like protrusions that make tandem contacts with their target molecule. Some of these domains bind zinc, but many do not; instead binding other metals such as iron, or no metal at all. For example, some family members form salt bridges to stabilise the finger-like folds. They were first identified as a DNA-binding motif in transcription factor TFIIIA from Xenopus laevis (African clawed frog), however they are now recognised to bind DNA, RNA, protein and/or lipid substrates [, , , , ]. Their binding properties depend on the amino acid sequence of the finger domains and of the linker between fingers, as well as on the higher-order structures and the number of fingers. Znf domains are often found in clusters, where fingers can have different binding specificities. There are many superfamilies of Znf motifs, varying in both sequence and structure. They display considerable versatility in binding modes, even between members of the same class (e.g. some bind DNA, others protein), suggesting that Znf motifs are stable scaffolds that have evolved specialised functions. For example, Znf-containing proteins function in gene transcription, translation, mRNA trafficking, cytoskeleton organisation, epithelial development, cell adhesion, protein folding, chromatin remodelling and zinc sensing, to name but a few []. Zinc-binding motifs are stable structures, and they rarely undergo conformational changes upon binding their target. This entry represents predicted BED-type zinc finger domains. The BED finger which was named after the Drosophila proteins BEAF and DREF, is found in one or more copies in cellular regulatory factors and transposases from plants, animals and fungi. The BED finger is an about 50 to 60 amino acid residues domain that contains a characteristic motif with two highly conserved aromatic positions, as well as a shared pattern of cysteines and histidines that is predicted to form a zinc finger. As diverse BED fingers are able to bind DNA, it has been suggested that DNA-binding is the general function of this domain []. Some proteins known to contain a BED domain include animal, plant and fungi AC1 and Hobo-like transposases; Caenorhabditis elegans Dpy-20 protein, a predicted cuticular gene transcriptional regulator; Drosophila BEAF (boundary element-associated factor), thought to be involved in chromatin insulation; Drosophila DREF, a transcriptional regulator for S-phase genes; and tobacco 3AF1 and tomato E4/E8-BP1, light- and ethylene-regulated DNA binding proteins that contain two BED fingers. More information about these proteins can be found at Protein of the Month: Zinc Fingers [].; GO: 0003677 DNA binding; PDB: 2DJR_A 2CT5_A.
Probab=24.02 E-value=58 Score=27.55 Aligned_cols=28 Identities=29% Similarity=0.642 Sum_probs=15.7
Q ss_pred CcceeeecccCCccCCh----hHHHHHHHhhc
Q 000417 981 SIRKFICRFCGLKFDLL----PDLGRHHQAAH 1008 (1534)
Q Consensus 981 geKpykC~~CgKsF~sk----s~LkrHH~rtH 1008 (1534)
+....+|.+|++.+... +.|.+|..+.|
T Consensus 13 ~~~~a~C~~C~~~~~~~~~~ts~l~~HL~~~h 44 (45)
T PF02892_consen 13 DKKKAKCKYCGKVIKYSSGGTSNLKRHLKKKH 44 (45)
T ss_dssp CSS-EEETTTTEE-----SSTHHHHHHHHHTT
T ss_pred CcCeEEeCCCCeEEeeCCCcHHHHHHhhhhhC
Confidence 34567788888887764 67777544555
No 130
>COG1198 PriA Primosomal protein N' (replication factor Y) - superfamily II helicase [DNA replication, recombination, and repair]
Probab=24.01 E-value=51 Score=44.07 Aligned_cols=25 Identities=8% Similarity=-0.202 Sum_probs=17.5
Q ss_pred CCCcccCCCCcccCCchhhhcccccccCCCCccCCCCCCc
Q 000417 1016 SRPHKKGIRFYAYKLKSGRLSRPRFKKGLGAVSYRIRNRG 1055 (1534)
Q Consensus 1016 eKpYkC~iC~K~F~sks~L~rH~r~H~gekpy~C~iCgks 1055 (1534)
.+...|.+||+ +...|..|+.||-.
T Consensus 460 ~~~L~CH~Cg~---------------~~~~p~~Cp~Cgs~ 484 (730)
T COG1198 460 TGQLRCHYCGY---------------QEPIPQSCPECGSE 484 (730)
T ss_pred CCeeEeCCCCC---------------CCCCCCCCCCCCCC
Confidence 45677888874 34567888888864
No 131
>TIGR00622 ssl1 transcription factor ssl1. This family is based on the phylogenomic analysis of JA Eisen (1999, Ph.D. Thesis, Stanford University).
Probab=23.57 E-value=57 Score=33.84 Aligned_cols=24 Identities=0% Similarity=-0.060 Sum_probs=12.1
Q ss_pred CcccCCCCcccCCchhhhcccccc
Q 000417 1018 PHKKGIRFYAYKLKSGRLSRPRFK 1041 (1534)
Q Consensus 1018 pYkC~iC~K~F~sks~L~rH~r~H 1041 (1534)
.|+|+.|...|-..-+.-.|...|
T Consensus 81 ~y~C~~C~~~FC~dCD~fiHe~Lh 104 (112)
T TIGR00622 81 RYVCAVCKNVFCVDCDVFVHESLH 104 (112)
T ss_pred ceeCCCCCCccccccchhhhhhcc
Confidence 455555555555555555554444
No 132
>COG1996 RPC10 DNA-directed RNA polymerase, subunit RPC10 (contains C4-type Zn-finger) [Transcription]
Probab=23.43 E-value=41 Score=29.95 Aligned_cols=29 Identities=14% Similarity=0.135 Sum_probs=19.2
Q ss_pred ceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcc
Q 000417 983 RKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYA 1027 (1534)
Q Consensus 983 KpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~ 1027 (1534)
..|+|-.||+.|. .+.. .....|+.||..
T Consensus 5 ~~Y~C~~Cg~~~~---~~~~-------------~~~irCp~Cg~r 33 (49)
T COG1996 5 MEYKCARCGREVE---LDQE-------------TRGIRCPYCGSR 33 (49)
T ss_pred EEEEhhhcCCeee---hhhc-------------cCceeCCCCCcE
Confidence 4688888888881 1222 456788888854
No 133
>PRK14890 putative Zn-ribbon RNA-binding protein; Provisional
Probab=22.86 E-value=53 Score=30.33 Aligned_cols=32 Identities=22% Similarity=0.285 Sum_probs=19.8
Q ss_pred ceeeecccCCc-cCChhHHHHHHHhhccCCCCCCCCCcccCCCCc
Q 000417 983 RKFICRFCGLK-FDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFY 1026 (1534)
Q Consensus 983 KpykC~~CgKs-F~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K 1026 (1534)
-.|.|+.||+. -.+-..-++ + ..+|.|+.||.
T Consensus 24 ~~F~CPnCG~~~I~RC~~CRk-----~-------~~~Y~CP~CGF 56 (59)
T PRK14890 24 VKFLCPNCGEVIIYRCEKCRK-----Q-------SNPYTCPKCGF 56 (59)
T ss_pred CEeeCCCCCCeeEeechhHHh-----c-------CCceECCCCCC
Confidence 46888888877 333322222 2 45888888875
No 134
>PF08666 SAF: SAF domain; InterPro: IPR013974 This entry includes a range of different proteins, such as antifreeze proteins, flagellar FlgA proteins, and CpaB pilus proteins. ; PDB: 1C89_A 3NLA_A 3RDN_A 1C8A_A 3FRN_A 1WVO_A 3K3S_H 3G8R_B 1XUU_A 1XUZ_A ....
Probab=21.73 E-value=53 Score=29.42 Aligned_cols=15 Identities=40% Similarity=0.547 Sum_probs=11.4
Q ss_pred EEEEccCCCCCCeEE
Q 000417 1493 GLYASRDIAVGEELT 1507 (1534)
Q Consensus 1493 afFA~RDI~aGEELT 1507 (1534)
.++|.|||++|+.|+
T Consensus 3 vvVA~~di~~G~~i~ 17 (63)
T PF08666_consen 3 VVVAARDIPAGTVIT 17 (63)
T ss_dssp EEEESSTB-TT-BEC
T ss_pred EEEEeCccCCCCEEc
Confidence 478999999999995
No 135
>PF14353 CpXC: CpXC protein
Probab=21.30 E-value=34 Score=35.60 Aligned_cols=20 Identities=40% Similarity=0.541 Sum_probs=15.9
Q ss_pred ceeeecccCCccCChhHHHH
Q 000417 983 RKFICRFCGLKFDLLPDLGR 1002 (1534)
Q Consensus 983 KpykC~~CgKsF~sks~Lkr 1002 (1534)
-.|.|+.||..|.-...+.-
T Consensus 37 ~~~~CP~Cg~~~~~~~p~lY 56 (128)
T PF14353_consen 37 FSFTCPSCGHKFRLEYPLLY 56 (128)
T ss_pred CEEECCCCCCceecCCCEEE
Confidence 46999999999987666655
No 136
>COG2888 Predicted Zn-ribbon RNA-binding protein with a function in translation [Translation, ribosomal structure and biogenesis]
Probab=21.16 E-value=61 Score=29.97 Aligned_cols=33 Identities=18% Similarity=0.067 Sum_probs=21.5
Q ss_pred ceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCc
Q 000417 983 RKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFY 1026 (1534)
Q Consensus 983 KpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K 1026 (1534)
-.|.|+.||..-..+..-- |.| ..+|.|+.||.
T Consensus 26 v~F~CPnCGe~~I~Rc~~C----Rk~-------g~~Y~Cp~CGF 58 (61)
T COG2888 26 VKFPCPNCGEVEIYRCAKC----RKL-------GNPYRCPKCGF 58 (61)
T ss_pred eEeeCCCCCceeeehhhhH----HHc-------CCceECCCcCc
Confidence 4688999996655544322 233 34899999985
No 137
>cd05834 HDGF_related The PWWP domain is an essential part of the Hepatoma Derived Growth Factor (HDGF) family of proteins, and is necessary for DNA binding by HDGF. This family of endogenous nuclear-targeted mitogens includes HRP (HDGF-related proteins 1, 2, 3, 4, or HPR1, HPR2, HPR3, HPR4, respectively) and lens epithelium-derived growth factor, LEDGF. Members of the HDGF family have been linked to human diseases, and HDGF is a prognostic factor in several types of cancer. The PWWP domain, named for a conserved Pro-Trp-Trp-Pro motif, is a small domain consisting of 100-150 amino acids. The PWWP domain is found in numerous proteins that are involved in cell division, growth and differentiation. Most PWWP-domain proteins seem to be nuclear, often DNA-binding, proteins that function as transcription factors regulating a variety of developmental processes.
Probab=21.07 E-value=1.2e+02 Score=29.69 Aligned_cols=52 Identities=23% Similarity=0.233 Sum_probs=35.5
Q ss_pred EEEEEeccc-cccceeeeeccCCCccccccccCCCccEEEEEeccCCcchhhhhhccccccCC
Q 000417 157 ALWVKWRGK-WQAGIRCARADWPLPTLKAKPTHDRKKYFVIFFPHTRNYSWADMLLVRSINEF 218 (1534)
Q Consensus 157 ~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 218 (1534)
-+|.|=+|- |=-|+=|...+. +-..++|.|.||. |..|.||..-.+.++.++
T Consensus 8 lVwaK~kGyp~WPa~I~~~~~~---------~~~~~~~~V~FfG-t~~~a~v~~~~l~pf~~~ 60 (83)
T cd05834 8 LVFAKVKGYPAWPARVDEPEDW---------KPPGKKYPVYFFG-THETAFLKPEDLFPYTEN 60 (83)
T ss_pred EEEEecCCCCCCCEEEeccccc---------CCCCCEEEEEEeC-CCCEeEECHHHceecccc
Confidence 368887773 333444444332 2235789999999 789999998888888775
No 138
>KOG1280 consensus Uncharacterized conserved protein containing ZZ-type Zn-finger [General function prediction only]
Probab=20.82 E-value=57 Score=39.48 Aligned_cols=29 Identities=24% Similarity=0.476 Sum_probs=23.1
Q ss_pred cceeeecccCCccCChhHHHHHHHhhccC
Q 000417 982 IRKFICRFCGLKFDLLPDLGRHHQAAHMG 1010 (1534)
Q Consensus 982 eKpykC~~CgKsF~sks~LkrHH~rtHtg 1010 (1534)
...|.|++|++.=.+...|..|....|..
T Consensus 77 ~qSftCPyC~~~Gfte~~f~~Hv~s~Hpd 105 (381)
T KOG1280|consen 77 PQSFTCPYCGIMGFTERQFGTHVLSQHPE 105 (381)
T ss_pred cccccCCcccccccchhHHHHHhhhcCcc
Confidence 35688888888888888888877788866
No 139
>PF13717 zinc_ribbon_4: zinc-ribbon domain
Probab=20.53 E-value=66 Score=26.64 Aligned_cols=14 Identities=21% Similarity=0.667 Sum_probs=7.2
Q ss_pred eecccCCccCChhH
Q 000417 986 ICRFCGLKFDLLPD 999 (1534)
Q Consensus 986 kC~~CgKsF~sks~ 999 (1534)
.|+.|+..|.-...
T Consensus 4 ~Cp~C~~~y~i~d~ 17 (36)
T PF13717_consen 4 TCPNCQAKYEIDDE 17 (36)
T ss_pred ECCCCCCEEeCCHH
Confidence 45555555554443
No 140
>KOG2593 consensus Transcription initiation factor IIE, alpha subunit [Transcription]
Probab=20.44 E-value=58 Score=40.61 Aligned_cols=47 Identities=13% Similarity=0.152 Sum_probs=30.2
Q ss_pred hhhhhhhcCCcceeeecccCCccCChhHHHHHHHhhccCCCCCCCCCcccCCCCcc
Q 000417 972 VENHSENLGSIRKFICRFCGLKFDLLPDLGRHHQAAHMGPNLVNSRPHKKGIRFYA 1027 (1534)
Q Consensus 972 Lk~HlrtHtgeKpykC~~CgKsF~sks~LkrHH~rtHtge~~~~eKpYkC~iC~K~ 1027 (1534)
|+.-++.-+....|.|+.|.++|.....|.- +..- ...|.|..|+-.
T Consensus 116 led~~~d~t~~~~Y~Cp~C~kkyt~Lea~~L--~~~~-------~~~F~C~~C~ge 162 (436)
T KOG2593|consen 116 LEDRLRDDTNVAGYVCPNCQKKYTSLEALQL--LDNE-------TGEFHCENCGGE 162 (436)
T ss_pred HHHHhhhccccccccCCccccchhhhHHHHh--hccc-------CceEEEecCCCc
Confidence 3444445555677999999999888777654 1111 236888888743
No 141
>smart00531 TFIIE Transcription initiation factor IIE.
Probab=20.36 E-value=58 Score=34.97 Aligned_cols=39 Identities=15% Similarity=0.173 Sum_probs=26.6
Q ss_pred CCCCCccccCCCchhhhhhhhhcCCcceeeecccCCccC
Q 000417 957 GEDSPKKLELGYSASVENHSENLGSIRKFICRFCGLKFD 995 (1534)
Q Consensus 957 geKp~~C~~Cgk~~sLk~HlrtHtgeKpykC~~CgKsF~ 995 (1534)
...-|.|+.|+..+....-+........|.|+.||....
T Consensus 96 ~~~~Y~Cp~C~~~y~~~ea~~~~d~~~~f~Cp~Cg~~l~ 134 (147)
T smart00531 96 NNAYYKCPNCQSKYTFLEANQLLDMDGTFTCPRCGEELE 134 (147)
T ss_pred CCcEEECcCCCCEeeHHHHHHhcCCCCcEECCCCCCEEE
Confidence 455688999998877655544321245599999998753
Done!