Query 040274
Match_columns 359
No_of_seqs 465 out of 3468
Neff 9.9
Searched_HMMs 46136
Date Fri Mar 29 06:47:32 2013
Command hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/040274.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/040274hhsearch_cdd -cpu 12 -v 0
No Hit Prob E-value P-value Score SS Cols Query HMM Template HMM
1 KOG1272 WD40-repeat-containing 100.0 5.5E-55 1.2E-59 384.0 19.8 345 8-359 40-543 (545)
2 KOG0272 U4/U6 small nuclear ri 100.0 1.3E-29 2.7E-34 221.7 16.2 165 52-221 265-458 (459)
3 KOG0272 U4/U6 small nuclear ri 100.0 2.5E-29 5.4E-34 219.9 16.3 151 69-224 263-419 (459)
4 KOG0271 Notchless-like WD40 re 100.0 1.1E-28 2.5E-33 213.4 18.5 180 52-235 119-439 (480)
5 KOG0286 G-protein beta subunit 100.0 3.2E-27 6.9E-32 198.0 20.3 153 69-225 147-305 (343)
6 KOG0263 Transcription initiati 100.0 2.4E-27 5.2E-32 222.0 16.9 166 52-222 455-648 (707)
7 KOG0263 Transcription initiati 100.0 2.5E-27 5.4E-32 221.9 16.4 162 69-235 453-649 (707)
8 KOG0279 G protein beta subunit 99.9 3.1E-25 6.7E-30 185.0 19.2 169 52-221 109-311 (315)
9 KOG0273 Beta-transducin family 99.9 3.2E-25 6.8E-30 196.7 18.8 167 52-223 239-482 (524)
10 KOG0284 Polyadenylation factor 99.9 2E-25 4.3E-30 194.7 14.4 178 52-235 100-337 (464)
11 KOG0279 G protein beta subunit 99.9 4.9E-24 1.1E-28 177.9 20.6 147 69-221 65-220 (315)
12 KOG0284 Polyadenylation factor 99.9 4.2E-25 9.1E-30 192.7 14.3 163 52-219 142-333 (464)
13 KOG0266 WD40 repeat-containing 99.9 4.4E-24 9.6E-29 202.8 22.6 170 52-223 163-364 (456)
14 KOG0286 G-protein beta subunit 99.9 2.7E-24 5.9E-29 180.5 17.6 147 69-220 188-342 (343)
15 KOG0645 WD40 repeat protein [G 99.9 2.3E-23 4.9E-28 173.3 22.2 166 52-221 18-223 (312)
16 KOG0315 G-protein beta subunit 99.9 6.1E-24 1.3E-28 174.7 18.2 166 52-222 44-244 (311)
17 KOG0268 Sof1-like rRNA process 99.9 3E-25 6.5E-30 191.1 9.6 186 91-282 169-392 (433)
18 KOG0291 WD40-repeat-containing 99.9 1.3E-23 2.8E-28 195.9 20.5 167 52-223 311-508 (893)
19 KOG0316 Conserved WD40 repeat- 99.9 1.3E-23 2.8E-28 171.5 17.3 176 52-234 21-256 (307)
20 KOG0271 Notchless-like WD40 re 99.9 4E-24 8.6E-29 185.3 14.8 149 69-223 117-276 (480)
21 KOG0266 WD40 repeat-containing 99.9 7.6E-23 1.7E-27 194.3 21.3 173 52-226 207-412 (456)
22 KOG0265 U5 snRNP-specific prot 99.9 3.4E-23 7.5E-28 174.5 16.6 164 52-220 51-243 (338)
23 KOG0283 WD40 repeat-containing 99.9 1.2E-22 2.7E-27 191.9 19.2 166 69-238 371-579 (712)
24 KOG0318 WD40 repeat stress pro 99.9 7.2E-22 1.6E-26 177.6 21.5 154 69-227 192-354 (603)
25 PTZ00421 coronin; Provisional 99.9 1.8E-21 3.9E-26 184.8 24.8 171 52-225 79-292 (493)
26 KOG0275 Conserved WD40 repeat- 99.9 5.7E-23 1.2E-27 174.8 12.0 180 52-232 217-478 (508)
27 KOG0295 WD40 repeat-containing 99.9 6.3E-22 1.4E-26 170.8 18.0 176 52-233 154-373 (406)
28 KOG0310 Conserved WD40 repeat- 99.9 9.9E-22 2.2E-26 175.4 19.7 178 52-234 72-278 (487)
29 KOG0273 Beta-transducin family 99.9 8.5E-22 1.8E-26 175.0 18.7 147 69-221 361-521 (524)
30 KOG0645 WD40 repeat protein [G 99.9 3E-21 6.6E-26 160.7 20.5 162 52-224 65-262 (312)
31 KOG0285 Pleiotropic regulator 99.9 3.8E-22 8.3E-27 171.8 14.7 155 69-228 153-312 (460)
32 KOG0277 Peroxisomal targeting 99.9 7.7E-22 1.7E-26 162.8 14.2 177 52-233 64-275 (311)
33 PLN00181 protein SPA1-RELATED; 99.9 7.4E-21 1.6E-25 193.2 24.3 167 52-223 487-690 (793)
34 PTZ00421 coronin; Provisional 99.9 1.2E-20 2.5E-25 179.4 23.4 147 69-219 77-241 (493)
35 KOG0315 G-protein beta subunit 99.9 6.4E-21 1.4E-25 157.0 18.0 177 52-233 87-297 (311)
36 KOG0285 Pleiotropic regulator 99.9 1.9E-21 4.2E-26 167.4 15.6 179 52-235 155-389 (460)
37 KOG0278 Serine/threonine kinas 99.9 3.6E-21 7.7E-26 158.6 16.2 169 52-227 104-301 (334)
38 KOG0293 WD40 repeat-containing 99.9 4E-21 8.7E-26 168.2 17.4 166 52-220 228-467 (519)
39 KOG0291 WD40-repeat-containing 99.9 6.1E-21 1.3E-25 178.2 19.4 168 52-224 354-551 (893)
40 KOG0282 mRNA splicing factor [ 99.9 1.2E-21 2.5E-26 174.7 13.6 167 52-221 218-460 (503)
41 KOG0319 WD40-repeat-containing 99.9 5.1E-21 1.1E-25 178.3 18.3 151 69-224 465-620 (775)
42 PTZ00420 coronin; Provisional 99.9 1.6E-20 3.4E-25 179.5 21.9 166 69-235 76-293 (568)
43 KOG0282 mRNA splicing factor [ 99.9 5.8E-22 1.3E-26 176.6 10.6 146 69-219 216-368 (503)
44 KOG0640 mRNA cleavage stimulat 99.9 4.1E-21 8.9E-26 162.7 14.7 173 52-228 116-340 (430)
45 KOG0641 WD40 repeat protein [G 99.9 5.4E-20 1.2E-24 149.6 19.8 162 52-219 93-299 (350)
46 KOG0276 Vesicle coat complex C 99.9 8.9E-21 1.9E-25 173.8 16.7 152 69-225 99-259 (794)
47 KOG0306 WD40-repeat-containing 99.9 8.9E-21 1.9E-25 177.0 16.9 165 52-221 458-662 (888)
48 KOG0318 WD40 repeat stress pro 99.9 5.6E-20 1.2E-24 165.6 21.3 87 52-138 194-349 (603)
49 KOG0275 Conserved WD40 repeat- 99.9 7.2E-22 1.6E-26 168.2 8.7 154 69-227 215-382 (508)
50 KOG0264 Nucleosome remodeling 99.9 8.4E-21 1.8E-25 168.2 15.3 153 69-222 229-403 (422)
51 KOG0278 Serine/threonine kinas 99.9 1.1E-20 2.3E-25 155.8 14.8 165 69-239 102-301 (334)
52 KOG1446 Histone H3 (Lys4) meth 99.9 1.3E-19 2.8E-24 154.2 21.7 183 52-235 18-262 (311)
53 KOG0277 Peroxisomal targeting 99.9 1.3E-20 2.9E-25 155.6 15.2 148 69-221 62-219 (311)
54 PTZ00420 coronin; Provisional 99.9 1.4E-19 3E-24 173.1 24.6 171 52-225 78-295 (568)
55 KOG0292 Vesicle coat complex C 99.9 6.7E-21 1.5E-25 180.6 13.9 146 69-219 11-161 (1202)
56 KOG0276 Vesicle coat complex C 99.9 1.7E-20 3.7E-25 171.9 16.1 163 52-219 101-295 (794)
57 cd00200 WD40 WD40 domain, foun 99.9 3.1E-19 6.6E-24 157.7 23.4 168 52-224 13-208 (289)
58 KOG0296 Angio-associated migra 99.8 7.2E-20 1.6E-24 158.2 18.0 159 69-232 66-229 (399)
59 KOG0269 WD40 repeat-containing 99.8 9.8E-21 2.1E-25 177.3 13.3 151 69-223 89-250 (839)
60 KOG0973 Histone transcription 99.8 3.4E-20 7.4E-25 179.7 17.2 175 52-231 73-320 (942)
61 KOG0305 Anaphase promoting com 99.8 8.3E-20 1.8E-24 168.5 18.7 149 69-222 303-460 (484)
62 KOG0292 Vesicle coat complex C 99.8 6.6E-20 1.4E-24 173.9 18.1 184 52-239 13-284 (1202)
63 KOG0283 WD40 repeat-containing 99.8 1.3E-20 2.8E-25 178.4 13.4 147 69-222 269-480 (712)
64 KOG0295 WD40 repeat-containing 99.8 1.1E-19 2.5E-24 156.9 17.8 164 52-220 197-403 (406)
65 KOG0289 mRNA splicing factor [ 99.8 7.4E-20 1.6E-24 161.3 16.9 166 52-221 307-504 (506)
66 KOG0646 WD40 repeat protein [G 99.8 1.9E-19 4E-24 160.1 19.4 172 52-225 85-309 (476)
67 KOG0265 U5 snRNP-specific prot 99.8 1.2E-19 2.6E-24 153.2 17.3 146 69-219 176-334 (338)
68 KOG0268 Sof1-like rRNA process 99.8 8.7E-21 1.9E-25 163.7 10.6 153 69-226 189-348 (433)
69 cd00200 WD40 WD40 domain, foun 99.8 3.5E-19 7.7E-24 157.3 21.3 164 52-220 97-288 (289)
70 PLN00181 protein SPA1-RELATED; 99.8 4.6E-19 1E-23 180.2 24.5 169 52-225 536-740 (793)
71 KOG0973 Histone transcription 99.8 7.6E-20 1.6E-24 177.4 17.3 159 52-212 17-238 (942)
72 KOG0639 Transducin-like enhanc 99.8 3E-20 6.5E-25 166.4 11.9 165 52-222 469-662 (705)
73 KOG0319 WD40-repeat-containing 99.8 1.7E-19 3.6E-24 168.3 16.9 174 44-221 15-220 (775)
74 KOG0772 Uncharacterized conser 99.8 4.7E-20 1E-24 165.6 12.5 160 52-213 218-429 (641)
75 KOG0643 Translation initiation 99.8 9.1E-19 2E-23 145.7 18.0 148 69-220 12-174 (327)
76 PF08149 BING4CT: BING4CT (NUC 99.8 2.3E-20 5E-25 126.1 6.8 79 185-264 2-80 (80)
77 KOG1273 WD40 repeat protein [G 99.8 7.6E-19 1.6E-23 149.3 17.0 194 70-264 26-259 (405)
78 KOG0299 U3 snoRNP-associated p 99.8 3.3E-19 7.2E-24 158.3 15.4 161 52-219 146-352 (479)
79 KOG0299 U3 snoRNP-associated p 99.8 5E-19 1.1E-23 157.1 16.5 181 52-232 206-419 (479)
80 KOG0281 Beta-TrCP (transducin 99.8 1.1E-19 2.4E-24 156.2 12.0 157 69-235 199-388 (499)
81 KOG0313 Microtubule binding pr 99.8 8.7E-19 1.9E-23 152.2 17.6 164 52-222 197-417 (423)
82 KOG0281 Beta-TrCP (transducin 99.8 1.3E-19 2.8E-24 155.8 11.8 158 69-237 239-430 (499)
83 KOG1274 WD40 repeat protein [G 99.8 1.3E-18 2.8E-23 166.0 19.6 153 69-224 98-263 (933)
84 KOG0296 Angio-associated migra 99.8 2E-18 4.4E-23 149.3 18.6 170 52-225 68-265 (399)
85 KOG4283 Transcription-coupled 99.8 5.7E-19 1.2E-23 148.8 14.8 180 52-232 47-285 (397)
86 KOG0289 mRNA splicing factor [ 99.8 1.3E-18 2.7E-23 153.6 17.5 167 52-223 223-419 (506)
87 KOG0772 Uncharacterized conser 99.8 5.2E-19 1.1E-23 159.0 15.3 168 52-221 171-392 (641)
88 KOG0293 WD40 repeat-containing 99.8 8E-19 1.7E-23 153.9 16.1 146 69-219 226-380 (519)
89 KOG1407 WD40 repeat protein [F 99.8 1.9E-18 4.2E-23 143.3 16.5 173 52-233 110-309 (313)
90 KOG0294 WD40 repeat-containing 99.8 1.7E-18 3.8E-23 147.1 16.0 140 69-216 45-191 (362)
91 KOG0640 mRNA cleavage stimulat 99.8 1.4E-18 3.1E-23 147.4 14.6 127 52-178 176-337 (430)
92 KOG0647 mRNA export protein (c 99.8 7.7E-18 1.7E-22 142.5 18.9 126 52-178 31-186 (347)
93 KOG0302 Ribosome Assembly prot 99.8 1.2E-18 2.6E-23 151.3 13.9 146 69-216 259-432 (440)
94 KOG1407 WD40 repeat protein [F 99.8 1.1E-17 2.4E-22 138.9 18.9 163 52-220 24-216 (313)
95 KOG0313 Microtubule binding pr 99.8 6.5E-18 1.4E-22 146.9 18.1 153 69-226 195-379 (423)
96 KOG0306 WD40-repeat-containing 99.8 5.7E-18 1.2E-22 158.5 18.8 183 52-239 377-626 (888)
97 KOG0639 Transducin-like enhanc 99.8 7.3E-19 1.6E-23 157.6 11.9 162 52-219 423-618 (705)
98 KOG0316 Conserved WD40 repeat- 99.8 5E-18 1.1E-22 139.0 15.7 147 69-221 19-171 (307)
99 KOG1036 Mitotic spindle checkp 99.8 3E-17 6.5E-22 139.3 20.8 163 52-219 17-203 (323)
100 KOG0264 Nucleosome remodeling 99.8 2.5E-18 5.4E-23 152.6 14.6 151 69-223 179-347 (422)
101 KOG0643 Translation initiation 99.8 1.4E-17 3E-22 138.7 17.9 167 52-223 14-220 (327)
102 KOG0310 Conserved WD40 repeat- 99.8 7.1E-18 1.5E-22 150.9 17.0 164 69-238 70-271 (487)
103 KOG0288 WD40 repeat protein Ti 99.8 4.1E-18 8.8E-23 149.5 14.2 173 52-225 179-419 (459)
104 KOG0267 Microtubule severing p 99.8 3.6E-19 7.7E-24 165.8 7.0 148 69-221 72-224 (825)
105 KOG0646 WD40 repeat protein [G 99.8 1.1E-17 2.3E-22 149.0 15.9 164 69-238 83-310 (476)
106 KOG0308 Conserved WD40 repeat- 99.8 2.7E-18 5.9E-23 158.3 12.4 167 52-223 28-243 (735)
107 KOG0288 WD40 repeat protein Ti 99.8 2.5E-17 5.3E-22 144.7 16.2 146 69-220 304-458 (459)
108 KOG0302 Ribosome Assembly prot 99.8 1.8E-17 3.9E-22 144.1 15.1 149 69-221 213-376 (440)
109 KOG1446 Histone H3 (Lys4) meth 99.8 2E-16 4.4E-21 134.8 20.3 160 69-233 102-271 (311)
110 KOG0294 WD40 repeat-containing 99.8 1.7E-16 3.6E-21 135.2 19.2 164 52-222 47-280 (362)
111 KOG0270 WD40 repeat-containing 99.8 3.2E-17 7E-22 145.2 15.5 154 69-226 245-407 (463)
112 KOG2096 WD40 repeat protein [G 99.8 3.9E-17 8.4E-22 139.2 15.3 158 71-233 232-413 (420)
113 KOG0269 WD40 repeat-containing 99.7 1.4E-17 3E-22 156.4 13.2 162 52-217 137-334 (839)
114 KOG0305 Anaphase promoting com 99.7 2.6E-17 5.7E-22 152.1 14.4 150 69-225 219-378 (484)
115 KOG0274 Cdc4 and related F-box 99.7 2.4E-16 5.2E-21 150.4 20.0 163 69-239 251-445 (537)
116 KOG0300 WD40 repeat-containing 99.7 8.6E-17 1.9E-21 137.1 14.7 149 69-222 274-427 (481)
117 KOG1332 Vesicle coat complex C 99.7 2.2E-16 4.8E-21 130.1 16.1 171 52-224 60-287 (299)
118 KOG0308 Conserved WD40 repeat- 99.7 1E-16 2.2E-21 148.1 15.2 146 69-219 119-281 (735)
119 KOG0303 Actin-binding protein 99.7 1.1E-16 2.4E-21 140.0 14.7 163 69-235 83-294 (472)
120 KOG2321 WD40 repeat protein [G 99.7 1.6E-16 3.4E-21 145.0 15.5 152 69-226 177-347 (703)
121 KOG2055 WD40 repeat protein [G 99.7 3.2E-16 6.9E-21 139.5 16.7 167 52-221 307-510 (514)
122 KOG2919 Guanine nucleotide-bin 99.7 2E-16 4.4E-21 135.1 14.0 164 47-214 157-361 (406)
123 KOG0641 WD40 repeat protein [G 99.7 1.8E-15 3.8E-20 123.5 18.8 170 52-222 36-260 (350)
124 KOG4283 Transcription-coupled 99.7 7.3E-16 1.6E-20 130.2 16.2 179 52-235 28-231 (397)
125 KOG0307 Vesicle coat complex C 99.7 4.7E-17 1E-21 158.9 10.2 171 52-226 68-287 (1049)
126 KOG2055 WD40 repeat protein [G 99.7 6.2E-16 1.3E-20 137.7 15.6 163 52-219 261-463 (514)
127 KOG0301 Phospholipase A2-activ 99.7 8E-16 1.7E-20 143.1 16.3 142 69-223 142-288 (745)
128 KOG2445 Nuclear pore complex c 99.7 5.3E-15 1.1E-19 125.7 19.4 163 52-219 17-252 (361)
129 KOG0274 Cdc4 and related F-box 99.7 1.4E-15 3E-20 145.3 17.8 163 52-224 253-442 (537)
130 KOG0647 mRNA export protein (c 99.7 1E-15 2.2E-20 129.7 14.4 143 69-219 29-180 (347)
131 KOG1007 WD repeat protein TSSC 99.7 1.2E-15 2.7E-20 128.5 14.8 151 69-225 125-291 (370)
132 KOG0301 Phospholipase A2-activ 99.7 1E-15 2.3E-20 142.3 15.4 155 69-235 103-288 (745)
133 KOG1274 WD40 repeat protein [G 99.7 1.7E-15 3.7E-20 145.0 17.1 159 52-219 100-296 (933)
134 KOG1332 Vesicle coat complex C 99.7 1E-15 2.3E-20 126.1 13.1 147 69-219 13-189 (299)
135 KOG0267 Microtubule severing p 99.7 1.2E-16 2.7E-21 149.1 8.1 161 52-217 74-262 (825)
136 KOG1445 Tumor-specific antigen 99.7 6.8E-16 1.5E-20 142.3 12.4 163 69-234 629-843 (1012)
137 KOG1539 WD repeat protein [Gen 99.7 1.7E-15 3.6E-20 143.6 15.3 164 52-222 452-647 (910)
138 KOG2445 Nuclear pore complex c 99.6 1.2E-14 2.6E-19 123.6 17.4 146 69-214 15-193 (361)
139 KOG1408 WD40 repeat protein [F 99.6 2.9E-15 6.2E-20 139.9 14.8 166 52-222 463-712 (1080)
140 KOG0303 Actin-binding protein 99.6 9.3E-15 2E-19 128.0 16.7 172 52-227 85-298 (472)
141 KOG0300 WD40 repeat-containing 99.6 1.2E-15 2.6E-20 130.1 10.8 163 69-236 150-387 (481)
142 KOG0649 WD40 repeat protein [G 99.6 1.7E-14 3.7E-19 119.0 17.1 159 69-236 116-297 (325)
143 KOG1273 WD40 repeat protein [G 99.6 1.6E-14 3.5E-19 123.2 17.4 181 51-233 26-289 (405)
144 KOG2919 Guanine nucleotide-bin 99.6 8.3E-15 1.8E-19 125.4 15.5 154 69-224 160-328 (406)
145 TIGR03866 PQQ_ABC_repeats PQQ- 99.6 6E-14 1.3E-18 126.1 21.8 168 52-226 76-282 (300)
146 KOG1034 Transcriptional repres 99.6 2.4E-14 5.2E-19 122.8 17.7 152 69-221 137-381 (385)
147 KOG2096 WD40 repeat protein [G 99.6 9.2E-15 2E-19 124.9 15.0 166 52-222 90-307 (420)
148 KOG1007 WD repeat protein TSSC 99.6 1.3E-14 2.8E-19 122.5 14.9 162 52-218 127-356 (370)
149 KOG2048 WD40 repeat protein [G 99.6 4E-14 8.6E-19 131.7 19.0 165 52-221 73-273 (691)
150 KOG0290 Conserved WD40 repeat- 99.6 1.6E-14 3.4E-19 122.0 14.3 150 69-222 152-317 (364)
151 KOG4328 WD40 protein [Function 99.6 1.8E-14 3.9E-19 128.4 14.9 171 52-223 190-399 (498)
152 KOG0270 WD40 repeat-containing 99.6 1.6E-14 3.5E-19 128.2 14.4 146 69-219 175-356 (463)
153 KOG4378 Nuclear protein COP1 [ 99.6 2.5E-14 5.5E-19 128.6 15.8 166 52-224 83-281 (673)
154 KOG1036 Mitotic spindle checkp 99.6 3.8E-14 8.3E-19 120.6 15.9 170 69-265 15-188 (323)
155 KOG2106 Uncharacterized conser 99.6 1.8E-13 4E-18 123.4 21.0 169 52-225 204-479 (626)
156 KOG2048 WD40 repeat protein [G 99.6 1.2E-13 2.6E-18 128.5 20.3 170 52-223 29-233 (691)
157 KOG1188 WD40 repeat protein [G 99.6 1.6E-14 3.4E-19 124.5 13.2 138 80-220 41-193 (376)
158 KOG1063 RNA polymerase II elon 99.6 3E-14 6.5E-19 132.8 16.0 169 52-220 529-760 (764)
159 KOG0771 Prolactin regulatory e 99.6 9.7E-15 2.1E-19 129.0 12.1 146 71-221 148-352 (398)
160 KOG2106 Uncharacterized conser 99.6 8.4E-14 1.8E-18 125.5 18.2 148 69-223 370-521 (626)
161 KOG4378 Nuclear protein COP1 [ 99.6 2.8E-14 6.1E-19 128.3 15.0 150 52-205 125-305 (673)
162 KOG0321 WD40 repeat-containing 99.6 3.2E-14 6.9E-19 131.5 15.5 186 52-239 104-395 (720)
163 KOG1539 WD repeat protein [Gen 99.6 2.8E-14 6.1E-19 135.5 15.4 148 69-221 450-604 (910)
164 PF08662 eIF2A: Eukaryotic tra 99.6 8.2E-14 1.8E-18 117.1 16.5 121 52-175 9-178 (194)
165 PF08662 eIF2A: Eukaryotic tra 99.6 1.7E-13 3.6E-18 115.2 18.2 151 71-235 9-179 (194)
166 KOG1009 Chromatin assembly com 99.6 4.4E-14 9.5E-19 124.2 14.9 95 52-146 17-160 (434)
167 KOG0307 Vesicle coat complex C 99.6 6.4E-15 1.4E-19 144.2 9.6 144 69-215 66-229 (1049)
168 KOG1063 RNA polymerase II elon 99.6 1.1E-13 2.4E-18 129.0 16.2 149 69-221 527-697 (764)
169 KOG2394 WD40 protein DMR-N9 [G 99.5 1.1E-13 2.4E-18 125.7 14.7 130 69-203 221-384 (636)
170 KOG0321 WD40 repeat-containing 99.5 1.9E-13 4.1E-18 126.5 16.1 168 69-237 102-349 (720)
171 KOG4328 WD40 protein [Function 99.5 1E-13 2.2E-18 123.6 13.2 157 69-226 281-453 (498)
172 KOG1523 Actin-related protein 99.5 1.5E-13 3.3E-18 117.6 13.7 151 69-220 12-173 (361)
173 KOG1523 Actin-related protein 99.5 3.5E-13 7.5E-18 115.4 15.6 175 52-226 14-239 (361)
174 KOG1524 WD40 repeat-containing 99.5 2.7E-13 5.9E-18 123.2 15.6 150 52-219 108-282 (737)
175 KOG1034 Transcriptional repres 99.5 3.3E-14 7.2E-19 121.9 9.2 154 69-225 91-281 (385)
176 KOG1538 Uncharacterized conser 99.5 8.5E-14 1.8E-18 129.3 12.1 142 69-219 14-158 (1081)
177 TIGR03866 PQQ_ABC_repeats PQQ- 99.5 2.1E-12 4.5E-17 116.0 20.9 150 69-225 32-189 (300)
178 KOG0650 WD40 repeat nucleolar 99.5 1.7E-13 3.7E-18 125.9 13.5 148 69-221 523-678 (733)
179 KOG1408 WD40 repeat protein [F 99.5 1.1E-12 2.3E-17 123.0 15.7 166 69-236 461-714 (1080)
180 KOG2110 Uncharacterized conser 99.5 5.2E-12 1.1E-16 110.2 18.8 108 69-176 131-248 (391)
181 KOG1445 Tumor-specific antigen 99.5 2.1E-13 4.5E-18 126.1 9.8 168 52-221 631-842 (1012)
182 PRK01742 tolB translocation pr 99.5 2.3E-12 5E-17 122.2 16.7 162 52-221 207-399 (429)
183 KOG0642 Cell-cycle nuclear pro 99.5 1.2E-12 2.6E-17 119.8 13.9 151 69-219 296-515 (577)
184 KOG1009 Chromatin assembly com 99.5 4.5E-13 9.7E-18 118.0 10.3 142 69-215 15-187 (434)
185 KOG0644 Uncharacterized conser 99.4 2.6E-13 5.7E-18 128.9 9.2 175 44-228 182-473 (1113)
186 KOG0650 WD40 repeat nucleolar 99.4 1.1E-12 2.3E-17 120.7 12.3 168 52-220 525-732 (733)
187 KOG4497 Uncharacterized conser 99.4 5.2E-12 1.1E-16 108.7 15.5 162 53-220 13-237 (447)
188 KOG4227 WD40 repeat protein [G 99.4 4.9E-12 1.1E-16 111.1 14.9 184 52-235 60-322 (609)
189 KOG2139 WD40 repeat protein [G 99.4 1.4E-11 3E-16 107.3 17.4 144 69-215 197-367 (445)
190 PRK11028 6-phosphogluconolacto 99.4 2.1E-11 4.7E-16 111.7 20.0 169 52-223 83-304 (330)
191 KOG1538 Uncharacterized conser 99.4 1.2E-11 2.6E-16 115.3 17.4 145 69-221 134-291 (1081)
192 KOG1188 WD40 repeat protein [G 99.4 2.5E-11 5.4E-16 105.0 17.6 167 69-239 72-256 (376)
193 PRK03629 tolB translocation pr 99.4 3.3E-11 7.1E-16 114.1 20.0 157 52-216 202-396 (429)
194 KOG0642 Cell-cycle nuclear pro 99.4 7.4E-12 1.6E-16 114.6 14.6 147 69-221 346-559 (577)
195 KOG2139 WD40 repeat protein [G 99.4 1.8E-11 4E-16 106.6 16.0 140 69-215 142-302 (445)
196 KOG2110 Uncharacterized conser 99.4 4.1E-11 9E-16 104.6 18.1 147 69-221 89-246 (391)
197 KOG1310 WD40 repeat protein [G 99.4 2.9E-12 6.3E-17 116.9 10.9 152 69-221 52-229 (758)
198 KOG0290 Conserved WD40 repeat- 99.4 1E-11 2.2E-16 105.2 13.3 165 69-237 98-320 (364)
199 KOG2394 WD40 protein DMR-N9 [G 99.4 3.7E-12 8.1E-17 115.9 11.2 89 69-157 292-383 (636)
200 PRK11028 6-phosphogluconolacto 99.4 1.6E-10 3.6E-15 105.8 22.1 172 52-224 38-259 (330)
201 COG2319 FOG: WD40 repeat [Gene 99.4 6.2E-11 1.3E-15 110.2 19.4 150 69-222 157-313 (466)
202 KOG0322 G-protein beta subunit 99.3 8.3E-12 1.8E-16 104.4 10.9 148 69-221 152-321 (323)
203 KOG1587 Cytoplasmic dynein int 99.3 2.3E-11 5E-16 115.9 15.4 115 104-221 393-514 (555)
204 PRK02889 tolB translocation pr 99.3 6.3E-11 1.4E-15 112.3 18.1 156 52-215 199-392 (427)
205 KOG1587 Cytoplasmic dynein int 99.3 5.6E-11 1.2E-15 113.2 17.3 147 69-219 244-424 (555)
206 KOG0644 Uncharacterized conser 99.3 1.1E-12 2.3E-17 124.9 5.5 145 69-216 192-339 (1113)
207 KOG3881 Uncharacterized conser 99.3 1.6E-10 3.4E-15 101.7 18.3 152 69-224 150-321 (412)
208 PRK05137 tolB translocation pr 99.3 1.5E-10 3.2E-15 110.1 19.8 155 52-214 205-397 (435)
209 PRK04922 tolB translocation pr 99.3 1.2E-10 2.7E-15 110.5 18.7 155 52-214 207-399 (433)
210 KOG4227 WD40 repeat protein [G 99.3 4.4E-11 9.6E-16 105.2 14.1 151 69-221 58-223 (609)
211 KOG2111 Uncharacterized conser 99.3 4.6E-10 1E-14 96.4 19.3 99 80-178 149-258 (346)
212 KOG1517 Guanine nucleotide bin 99.3 4.4E-11 9.6E-16 116.7 14.6 154 69-222 1210-1380(1387)
213 KOG1240 Protein kinase contain 99.3 1.1E-10 2.4E-15 115.6 16.3 179 52-234 1030-1284(1431)
214 PRK01742 tolB translocation pr 99.2 9.1E-11 2E-15 111.3 13.1 146 52-204 251-426 (429)
215 KOG1524 WD40 repeat-containing 99.2 1.9E-10 4E-15 105.0 14.2 150 56-214 81-247 (737)
216 KOG1963 WD40 repeat protein [G 99.2 9.4E-10 2E-14 105.9 19.1 154 69-224 207-376 (792)
217 TIGR02800 propeller_TolB tol-p 99.2 8.4E-10 1.8E-14 104.5 19.0 156 52-215 193-386 (417)
218 KOG1310 WD40 repeat protein [G 99.2 2.5E-10 5.3E-15 104.5 14.0 175 52-226 54-306 (758)
219 COG2319 FOG: WD40 repeat [Gene 99.2 2.6E-09 5.7E-14 99.2 21.5 170 52-227 69-275 (466)
220 PRK02889 tolB translocation pr 99.2 1.7E-09 3.6E-14 102.6 18.8 141 69-215 197-349 (427)
221 KOG4497 Uncharacterized conser 99.2 9.1E-10 2E-14 95.1 15.1 166 52-223 182-432 (447)
222 PRK03629 tolB translocation pr 99.2 2.3E-09 5E-14 101.6 18.6 139 69-214 200-351 (429)
223 KOG1272 WD40-repeat-containing 99.2 6.2E-11 1.3E-15 106.4 7.0 143 72-222 214-361 (545)
224 PRK00178 tolB translocation pr 99.2 5.3E-09 1.2E-13 99.4 20.6 155 52-214 202-394 (430)
225 KOG0649 WD40 repeat protein [G 99.2 7.9E-10 1.7E-14 91.7 12.7 144 70-221 13-184 (325)
226 KOG0771 Prolactin regulatory e 99.1 6.3E-10 1.4E-14 98.9 12.7 124 52-176 148-354 (398)
227 PRK04922 tolB translocation pr 99.1 2.1E-09 4.6E-14 102.1 17.3 139 69-214 205-356 (433)
228 KOG2321 WD40 repeat protein [G 99.1 4.7E-10 1E-14 103.3 12.0 154 69-226 135-305 (703)
229 PRK05137 tolB translocation pr 99.1 2.8E-09 6E-14 101.4 17.9 139 69-214 203-354 (435)
230 KOG1517 Guanine nucleotide bin 99.1 9.5E-10 2.1E-14 107.7 14.7 154 71-226 1169-1336(1387)
231 KOG1963 WD40 repeat protein [G 99.1 1.4E-09 3E-14 104.7 15.6 182 52-236 209-439 (792)
232 KOG0974 WD-repeat protein WDR6 99.1 1.2E-09 2.7E-14 106.8 15.4 143 73-220 139-285 (967)
233 KOG3881 Uncharacterized conser 99.1 1.3E-09 2.9E-14 96.0 13.9 130 69-204 204-342 (412)
234 KOG0280 Uncharacterized conser 99.1 1.5E-09 3.2E-14 92.4 13.3 175 52-227 125-337 (339)
235 PRK01029 tolB translocation pr 99.1 6.8E-09 1.5E-13 98.2 19.3 139 69-213 232-390 (428)
236 KOG2315 Predicted translation 99.1 4.3E-09 9.4E-14 96.8 16.9 140 70-218 220-379 (566)
237 PRK04792 tolB translocation pr 99.1 6.7E-09 1.5E-13 98.9 18.6 156 52-215 221-414 (448)
238 PF10282 Lactonase: Lactonase, 99.1 6.1E-08 1.3E-12 89.3 23.2 171 52-223 90-322 (345)
239 KOG2314 Translation initiation 99.1 1.1E-08 2.4E-13 94.1 17.5 56 52-107 214-300 (698)
240 TIGR02800 propeller_TolB tol-p 99.1 1.2E-08 2.6E-13 96.6 18.3 140 69-215 191-343 (417)
241 KOG1064 RAVE (regulator of V-A 99.0 1.8E-09 4E-14 110.7 12.5 165 69-238 2210-2401(2439)
242 PRK00178 tolB translocation pr 99.0 4.1E-08 8.8E-13 93.4 20.9 139 69-214 200-351 (430)
243 KOG1275 PAB-dependent poly(A) 99.0 4E-09 8.7E-14 102.0 13.7 150 78-232 186-350 (1118)
244 PRK04792 tolB translocation pr 99.0 2E-08 4.4E-13 95.6 17.4 145 69-220 219-377 (448)
245 PRK04043 tolB translocation pr 99.0 6.7E-08 1.4E-12 91.0 20.1 155 52-215 191-389 (419)
246 KOG2695 WD40 repeat protein [G 99.0 1E-09 2.2E-14 95.3 6.4 133 69-203 254-402 (425)
247 KOG0280 Uncharacterized conser 99.0 1.4E-08 3E-13 86.7 12.5 142 70-216 124-278 (339)
248 PRK01029 tolB translocation pr 98.9 2.6E-08 5.6E-13 94.2 15.7 148 52-205 234-426 (428)
249 KOG0322 G-protein beta subunit 98.9 1.4E-09 3.1E-14 91.2 5.9 70 69-138 253-322 (323)
250 PF02239 Cytochrom_D1: Cytochr 98.9 1.8E-07 3.9E-12 86.5 20.3 145 71-220 40-199 (369)
251 COG2706 3-carboxymuconate cycl 98.9 7.5E-07 1.6E-11 78.5 22.0 164 52-215 43-265 (346)
252 COG2706 3-carboxymuconate cycl 98.9 5.4E-07 1.2E-11 79.4 20.8 162 52-215 92-312 (346)
253 KOG1354 Serine/threonine prote 98.9 1.9E-08 4.2E-13 87.5 11.1 152 69-221 166-357 (433)
254 KOG2111 Uncharacterized conser 98.9 2.9E-07 6.2E-12 79.6 18.0 149 69-223 96-256 (346)
255 KOG0974 WD-repeat protein WDR6 98.9 1.7E-08 3.6E-13 99.1 11.4 106 69-177 177-289 (967)
256 KOG2315 Predicted translation 98.9 8.5E-08 1.8E-12 88.5 14.8 128 69-206 272-413 (566)
257 PF00400 WD40: WD domain, G-be 98.8 1.2E-08 2.6E-13 61.8 6.1 38 100-137 2-39 (39)
258 PF15492 Nbas_N: Neuroblastoma 98.8 1.3E-06 2.8E-11 74.8 20.2 170 52-222 1-258 (282)
259 KOG4547 WD40 repeat-containing 98.8 1.6E-07 3.4E-12 87.3 15.1 138 78-220 69-217 (541)
260 PF02239 Cytochrom_D1: Cytochr 98.8 4.3E-07 9.3E-12 84.0 17.7 139 82-221 9-156 (369)
261 KOG3914 WD repeat protein WDR4 98.8 7.8E-08 1.7E-12 85.4 11.0 127 52-179 66-226 (390)
262 COG4946 Uncharacterized protei 98.7 8.1E-07 1.8E-11 80.7 17.1 139 69-214 361-509 (668)
263 KOG3617 WD40 and TPR repeat-co 98.7 2.8E-07 6.1E-12 88.9 13.7 88 52-139 19-131 (1416)
264 KOG2314 Translation initiation 98.7 1.7E-07 3.8E-12 86.4 11.6 136 69-212 212-365 (698)
265 PLN02919 haloacid dehalogenase 98.7 3.6E-06 7.9E-11 87.9 22.8 154 71-227 686-892 (1057)
266 PF10282 Lactonase: Lactonase, 98.7 8.4E-06 1.8E-10 75.1 22.8 164 69-232 38-231 (345)
267 KOG1334 WD40 repeat protein [G 98.7 2.6E-07 5.6E-12 84.0 11.1 167 52-218 146-361 (559)
268 KOG1354 Serine/threonine prote 98.6 3.1E-07 6.7E-12 80.2 10.9 126 52-178 168-361 (433)
269 PRK04043 tolB translocation pr 98.6 5.4E-06 1.2E-10 78.2 19.9 137 69-214 189-339 (419)
270 KOG4714 Nucleoporin [Nuclear s 98.6 1.7E-07 3.8E-12 78.8 8.5 72 69-140 181-255 (319)
271 KOG4190 Uncharacterized conser 98.6 1.4E-07 2.9E-12 87.1 8.1 161 69-233 737-915 (1034)
272 KOG4547 WD40 repeat-containing 98.6 2.6E-06 5.7E-11 79.3 15.6 107 69-177 104-221 (541)
273 KOG1240 Protein kinase contain 98.6 2.4E-06 5.2E-11 85.8 16.2 156 70-225 1152-1336(1431)
274 KOG0309 Conserved WD40 repeat- 98.5 1.6E-07 3.4E-12 89.3 7.1 165 52-221 28-230 (1081)
275 KOG4532 WD40-like repeat conta 98.5 6.9E-06 1.5E-10 69.6 16.0 142 82-223 131-282 (344)
276 KOG1334 WD40 repeat protein [G 98.5 2.5E-07 5.4E-12 84.1 7.6 151 69-221 144-310 (559)
277 KOG2041 WD40 repeat protein [G 98.5 3.7E-07 8.1E-12 86.6 8.9 145 69-220 16-183 (1189)
278 KOG1912 WD40 repeat protein [G 98.5 2E-06 4.4E-11 82.5 13.6 143 70-219 18-182 (1062)
279 PF04762 IKI3: IKI3 family; I 98.5 8.1E-06 1.8E-10 83.8 18.2 149 69-221 122-331 (928)
280 KOG4532 WD40-like repeat conta 98.5 8.4E-06 1.8E-10 69.1 14.6 111 69-179 160-285 (344)
281 TIGR02658 TTQ_MADH_Hv methylam 98.5 5.5E-05 1.2E-09 68.9 21.0 148 72-226 109-333 (352)
282 KOG2695 WD40 repeat protein [G 98.5 4E-07 8.7E-12 79.5 6.8 151 71-225 215-378 (425)
283 KOG1064 RAVE (regulator of V-A 98.4 5.5E-07 1.2E-11 93.2 8.3 155 52-224 2212-2399(2439)
284 KOG2066 Vacuolar assembly/sort 98.4 2.9E-06 6.2E-11 81.8 11.4 132 69-216 41-181 (846)
285 COG5170 CDC55 Serine/threonine 98.4 4.7E-06 1E-10 72.1 11.4 161 52-213 30-300 (460)
286 COG4946 Uncharacterized protei 98.3 4.3E-05 9.3E-10 69.8 16.9 135 75-217 327-467 (668)
287 COG5354 Uncharacterized protei 98.3 1.7E-05 3.7E-10 72.9 14.3 148 52-215 226-421 (561)
288 PF08450 SGL: SMP-30/Gluconola 98.3 0.00026 5.5E-09 62.0 21.7 151 69-223 41-213 (246)
289 PF11768 DUF3312: Protein of u 98.3 1.7E-05 3.7E-10 74.5 14.6 110 69-178 207-331 (545)
290 PLN02919 haloacid dehalogenase 98.3 3.2E-05 6.8E-10 81.0 17.8 108 71-178 743-890 (1057)
291 PF08450 SGL: SMP-30/Gluconola 98.3 0.00019 4.2E-09 62.7 20.1 136 69-212 87-244 (246)
292 PF11768 DUF3312: Protein of u 98.3 5.9E-06 1.3E-10 77.5 10.7 71 69-141 261-331 (545)
293 PF04053 Coatomer_WDAD: Coatom 98.3 4E-05 8.6E-10 72.3 16.3 167 52-233 36-232 (443)
294 KOG0309 Conserved WD40 repeat- 98.3 6.7E-06 1.4E-10 78.6 10.9 135 69-207 116-259 (1081)
295 KOG1832 HIV-1 Vpr-binding prot 98.3 1.2E-06 2.5E-11 85.3 5.8 139 69-209 1103-1246(1516)
296 COG5354 Uncharacterized protei 98.3 3.7E-05 8.1E-10 70.7 14.6 135 71-213 226-379 (561)
297 KOG1645 RING-finger-containing 98.2 7E-06 1.5E-10 73.3 9.6 132 52-187 139-277 (463)
298 KOG1409 Uncharacterized conser 98.2 3.2E-05 6.9E-10 67.9 13.5 96 81-176 167-270 (404)
299 KOG1912 WD40 repeat protein [G 98.2 7.1E-05 1.5E-09 72.3 16.8 106 52-158 19-165 (1062)
300 KOG2041 WD40 repeat protein [G 98.2 1.6E-05 3.4E-10 76.0 12.4 168 52-220 18-244 (1189)
301 KOG3914 WD repeat protein WDR4 98.2 2.7E-05 5.9E-10 69.5 12.7 159 69-234 64-233 (390)
302 PF04762 IKI3: IKI3 family; I 98.2 8.8E-05 1.9E-09 76.4 18.1 172 52-224 213-457 (928)
303 PF07433 DUF1513: Protein of u 98.2 0.00029 6.3E-09 62.3 18.7 152 53-214 55-277 (305)
304 KOG1008 Uncharacterized conser 98.2 7.2E-07 1.6E-11 83.9 1.7 152 69-220 104-272 (783)
305 KOG4714 Nucleoporin [Nuclear s 98.1 9.3E-06 2E-10 68.6 7.3 140 79-222 101-253 (319)
306 COG0823 TolB Periplasmic compo 98.1 8.3E-05 1.8E-09 69.9 13.5 140 69-215 239-391 (425)
307 TIGR02658 TTQ_MADH_Hv methylam 98.0 0.00054 1.2E-08 62.5 17.8 88 89-178 27-138 (352)
308 KOG4640 Anaphase-promoting com 98.0 2.6E-05 5.7E-10 73.6 9.1 89 69-158 22-115 (665)
309 COG5170 CDC55 Serine/threonine 98.0 4.4E-05 9.5E-10 66.2 9.7 152 69-221 174-365 (460)
310 PF00400 WD40: WD domain, G-be 98.0 1.3E-05 2.8E-10 48.1 4.7 27 69-95 13-39 (39)
311 KOG2066 Vacuolar assembly/sort 98.0 0.00037 8.1E-09 67.7 16.5 135 78-216 82-227 (846)
312 KOG1409 Uncharacterized conser 98.0 0.00021 4.6E-09 62.8 13.6 155 69-227 70-231 (404)
313 KOG1920 IkappaB kinase complex 98.0 0.00067 1.5E-08 68.9 18.2 147 69-222 111-321 (1265)
314 PF07433 DUF1513: Protein of u 97.9 0.0014 3E-08 58.1 17.9 144 70-215 7-184 (305)
315 PRK02888 nitrous-oxide reducta 97.9 0.00052 1.1E-08 66.2 16.4 160 52-215 238-453 (635)
316 KOG1645 RING-finger-containing 97.9 0.00012 2.5E-09 65.7 11.0 73 69-142 195-269 (463)
317 PF13360 PQQ_2: PQQ-like domai 97.9 0.00058 1.3E-08 59.2 14.5 138 87-226 1-143 (238)
318 PF04053 Coatomer_WDAD: Coatom 97.9 0.0007 1.5E-08 64.0 15.6 132 69-217 34-168 (443)
319 smart00320 WD40 WD40 repeats. 97.8 5.7E-05 1.2E-09 44.0 5.4 38 100-137 3-40 (40)
320 PF08553 VID27: VID27 cytoplas 97.8 0.0005 1.1E-08 68.6 14.7 126 87-217 502-642 (794)
321 PF15492 Nbas_N: Neuroblastoma 97.8 0.0025 5.4E-08 55.1 16.5 138 73-215 3-169 (282)
322 KOG1920 IkappaB kinase complex 97.8 0.0017 3.8E-08 66.0 17.9 139 69-214 70-262 (1265)
323 KOG0882 Cyclophilin-related pe 97.8 7.9E-05 1.7E-09 67.7 7.8 142 78-223 19-174 (558)
324 KOG3617 WD40 and TPR repeat-co 97.8 3.5E-05 7.6E-10 75.0 5.9 103 113-221 19-129 (1416)
325 COG0823 TolB Periplasmic compo 97.8 0.00047 1E-08 64.9 12.8 138 69-213 194-345 (425)
326 KOG3621 WD40 repeat-containing 97.7 0.00026 5.7E-09 67.8 10.3 106 55-160 40-182 (726)
327 PF14783 BBS2_Mid: Ciliary BBS 97.7 0.0026 5.6E-08 47.3 13.5 96 70-171 2-109 (111)
328 PRK13616 lipoprotein LpqB; Pro 97.7 0.00091 2E-08 65.7 14.4 144 69-219 351-521 (591)
329 KOG2114 Vacuolar assembly/sort 97.7 0.0026 5.6E-08 62.5 16.5 156 55-214 30-235 (933)
330 PRK13616 lipoprotein LpqB; Pro 97.7 0.003 6.4E-08 62.1 17.3 161 52-220 353-565 (591)
331 TIGR03300 assembly_YfgL outer 97.6 0.0012 2.6E-08 61.6 13.6 131 79-220 241-376 (377)
332 PRK02888 nitrous-oxide reducta 97.6 0.003 6.5E-08 61.2 16.0 162 58-223 185-404 (635)
333 PF14783 BBS2_Mid: Ciliary BBS 97.6 0.004 8.7E-08 46.3 13.2 97 112-218 2-109 (111)
334 TIGR03300 assembly_YfgL outer 97.6 0.0026 5.6E-08 59.4 15.3 143 78-225 64-210 (377)
335 KOG3621 WD40 repeat-containing 97.6 0.00055 1.2E-08 65.7 10.5 113 109-221 33-152 (726)
336 KOG2114 Vacuolar assembly/sort 97.6 0.0029 6.3E-08 62.2 15.5 130 74-207 30-185 (933)
337 KOG1832 HIV-1 Vpr-binding prot 97.5 4.5E-05 9.8E-10 74.6 2.5 127 69-212 1186-1320(1516)
338 COG3391 Uncharacterized conser 97.5 0.027 5.9E-07 52.7 20.9 146 69-219 117-279 (381)
339 KOG1275 PAB-dependent poly(A) 97.5 0.0013 2.9E-08 64.9 12.1 97 80-178 148-256 (1118)
340 KOG2395 Protein involved in va 97.5 0.0028 6.1E-08 59.2 13.2 132 82-219 349-497 (644)
341 KOG4649 PQQ (pyrrolo-quinoline 97.5 0.018 3.8E-07 49.4 16.8 96 78-173 62-162 (354)
342 KOG4190 Uncharacterized conser 97.4 0.00034 7.5E-09 65.2 6.6 121 102-226 728-862 (1034)
343 PF00930 DPPIV_N: Dipeptidyl p 97.4 0.016 3.4E-07 53.7 17.9 60 69-129 44-120 (353)
344 PF06977 SdiA-regulated: SdiA- 97.4 0.02 4.3E-07 49.8 17.1 184 69-266 23-233 (248)
345 PF13360 PQQ_2: PQQ-like domai 97.4 0.014 3.1E-07 50.4 16.4 141 78-226 75-233 (238)
346 KOG1008 Uncharacterized conser 97.3 7.8E-05 1.7E-09 70.6 1.5 146 69-221 58-223 (783)
347 COG3490 Uncharacterized protei 97.3 0.028 6.1E-07 48.8 16.2 154 57-215 44-247 (366)
348 PF10647 Gmad1: Lipoprotein Lp 97.1 0.041 8.8E-07 48.3 16.3 144 69-216 25-188 (253)
349 KOG0882 Cyclophilin-related pe 97.1 0.0069 1.5E-07 55.5 11.1 155 69-226 55-234 (558)
350 PF14870 PSII_BNR: Photosynthe 97.1 0.18 3.8E-06 45.3 19.9 141 69-213 146-295 (302)
351 COG3391 Uncharacterized conser 97.1 0.082 1.8E-06 49.4 18.6 150 70-221 76-237 (381)
352 PF00780 CNH: CNH domain; Int 97.1 0.03 6.5E-07 49.7 15.0 136 77-219 5-162 (275)
353 PF12234 Rav1p_C: RAVE protein 97.0 0.015 3.2E-07 56.9 13.3 106 69-174 31-154 (631)
354 PF04841 Vps16_N: Vps16, N-ter 97.0 0.12 2.6E-06 48.8 18.8 48 90-139 62-109 (410)
355 COG3386 Gluconolactonase [Carb 97.0 0.12 2.5E-06 46.7 17.7 137 69-212 112-274 (307)
356 PF06977 SdiA-regulated: SdiA- 96.9 0.087 1.9E-06 45.9 16.3 157 52-210 25-238 (248)
357 PF03178 CPSF_A: CPSF A subuni 96.9 0.078 1.7E-06 48.3 16.8 139 79-222 42-201 (321)
358 PF06433 Me-amine-dh_H: Methyl 96.9 0.15 3.3E-06 46.0 17.5 157 70-226 38-216 (342)
359 PRK11138 outer membrane biogen 96.9 0.034 7.4E-07 52.3 14.4 139 80-226 206-356 (394)
360 PF08596 Lgl_C: Lethal giant l 96.8 0.036 7.8E-07 51.8 13.9 107 69-176 3-173 (395)
361 PRK11138 outer membrane biogen 96.8 0.03 6.6E-07 52.6 13.4 101 78-179 68-181 (394)
362 PF12894 Apc4_WD40: Anaphase-p 96.8 0.0039 8.5E-08 38.9 4.9 32 69-101 13-44 (47)
363 PF14583 Pectate_lyase22: Olig 96.8 0.086 1.9E-06 48.4 15.4 157 52-210 39-254 (386)
364 smart00320 WD40 WD40 repeats. 96.7 0.0031 6.8E-08 36.1 4.1 27 69-95 14-40 (40)
365 COG3204 Uncharacterized protei 96.7 0.21 4.5E-06 43.9 16.4 148 69-216 87-256 (316)
366 KOG4640 Anaphase-promoting com 96.6 0.011 2.4E-07 56.4 8.4 90 109-203 20-115 (665)
367 PF15390 DUF4613: Domain of un 96.5 0.086 1.9E-06 50.4 14.0 141 69-220 21-183 (671)
368 PF14870 PSII_BNR: Photosynthe 96.5 0.55 1.2E-05 42.2 20.7 113 108-224 143-260 (302)
369 PF02897 Peptidase_S9_N: Proly 96.5 0.16 3.5E-06 48.0 16.5 106 71-177 127-261 (414)
370 PF12894 Apc4_WD40: Anaphase-p 96.5 0.0082 1.8E-07 37.5 5.0 35 109-144 11-45 (47)
371 PF03178 CPSF_A: CPSF A subuni 96.5 0.13 2.9E-06 46.8 15.2 146 69-222 90-264 (321)
372 PF00930 DPPIV_N: Dipeptidyl p 96.5 0.013 2.7E-07 54.3 8.4 97 118-214 1-121 (353)
373 KOG2079 Vacuolar assembly/sort 96.4 0.099 2.1E-06 53.2 14.3 68 69-138 132-202 (1206)
374 PF15390 DUF4613: Domain of un 96.4 0.18 4E-06 48.3 15.1 107 69-175 58-185 (671)
375 PF02897 Peptidase_S9_N: Proly 96.4 0.89 1.9E-05 43.0 20.4 89 53-141 128-262 (414)
376 KOG2079 Vacuolar assembly/sort 96.4 0.012 2.6E-07 59.6 7.7 70 78-147 98-168 (1206)
377 PF08553 VID27: VID27 cytoplas 96.3 0.028 6.1E-07 56.5 10.2 94 81-175 544-646 (794)
378 KOG3630 Nuclear pore complex, 96.2 0.036 7.9E-07 56.5 10.1 141 69-211 102-261 (1405)
379 PRK13684 Ycf48-like protein; P 96.2 0.97 2.1E-05 41.4 19.1 143 69-217 174-325 (334)
380 cd00216 PQQ_DH Dehydrogenases 96.2 0.24 5.1E-06 48.1 15.8 153 74-226 223-427 (488)
381 PF05096 Glu_cyclase_2: Glutam 96.2 0.76 1.6E-05 40.1 18.3 154 70-226 47-206 (264)
382 TIGR02604 Piru_Ver_Nterm putat 96.1 0.32 6.9E-06 45.3 15.7 139 69-215 15-205 (367)
383 KOG4499 Ca2+-binding protein R 96.0 0.15 3.2E-06 43.2 11.4 92 69-160 159-265 (310)
384 COG3386 Gluconolactonase [Carb 95.9 0.63 1.4E-05 42.0 15.7 89 69-158 164-264 (307)
385 KOG4649 PQQ (pyrrolo-quinoline 95.8 1.1 2.5E-05 38.7 15.8 98 79-178 23-125 (354)
386 PF14655 RAB3GAP2_N: Rab3 GTPa 95.8 1.1 2.5E-05 42.0 17.4 42 77-119 77-118 (415)
387 COG3490 Uncharacterized protei 95.7 0.33 7.2E-06 42.4 12.5 92 74-165 120-243 (366)
388 PF10647 Gmad1: Lipoprotein Lp 95.7 0.38 8.3E-06 42.2 13.5 100 111-212 25-130 (253)
389 KOG2377 Uncharacterized conser 95.6 0.46 9.9E-06 44.3 13.8 138 71-213 26-173 (657)
390 PRK10115 protease 2; Provision 95.6 3 6.5E-05 42.3 21.7 167 52-223 130-344 (686)
391 PF10168 Nup88: Nuclear pore c 95.4 1.3 2.9E-05 44.7 17.6 73 69-141 86-181 (717)
392 COG4257 Vgb Streptogramin lyas 95.4 0.94 2E-05 39.5 13.9 132 69-216 63-211 (353)
393 PF12234 Rav1p_C: RAVE protein 95.4 0.34 7.4E-06 47.7 12.9 99 111-212 31-147 (631)
394 PF04841 Vps16_N: Vps16, N-ter 95.3 1.2 2.7E-05 42.1 16.4 66 109-174 216-285 (410)
395 PLN00033 photosystem II stabil 95.3 2.2 4.7E-05 40.1 17.6 136 73-213 244-390 (398)
396 KOG2395 Protein involved in va 95.3 0.14 3.1E-06 48.3 9.5 108 69-177 377-501 (644)
397 PF14781 BBS2_N: Ciliary BBSom 95.3 0.68 1.5E-05 35.8 11.6 102 71-174 2-123 (136)
398 KOG3630 Nuclear pore complex, 95.2 0.18 3.9E-06 51.8 10.7 107 110-221 101-226 (1405)
399 PF08596 Lgl_C: Lethal giant l 95.0 1.7 3.6E-05 40.9 15.9 146 69-220 88-287 (395)
400 PF06433 Me-amine-dh_H: Methyl 94.9 2.8 6.1E-05 38.1 19.4 168 52-226 98-323 (342)
401 COG5167 VID27 Protein involved 94.9 0.97 2.1E-05 42.8 13.7 134 78-219 478-629 (776)
402 PHA02713 hypothetical protein; 94.9 0.34 7.3E-06 47.8 11.7 131 78-216 351-524 (557)
403 PF10313 DUF2415: Uncharacteri 94.8 0.11 2.4E-06 31.4 5.0 31 110-140 1-34 (43)
404 KOG2444 WD40 repeat protein [G 94.8 0.14 3E-06 43.2 7.3 93 78-174 69-164 (238)
405 PF10168 Nup88: Nuclear pore c 94.8 1.7 3.8E-05 43.9 16.3 48 52-99 88-181 (717)
406 cd00216 PQQ_DH Dehydrogenases 94.7 1.1 2.3E-05 43.5 14.5 68 79-147 61-136 (488)
407 KOG4441 Proteins containing BT 94.7 0.62 1.3E-05 46.0 12.7 150 78-233 380-551 (571)
408 TIGR02604 Piru_Ver_Nterm putat 94.6 0.83 1.8E-05 42.5 12.9 95 69-166 73-202 (367)
409 KOG4460 Nuclear pore complex, 94.6 0.57 1.2E-05 44.4 11.4 91 69-178 105-200 (741)
410 PF10214 Rrn6: RNA polymerase 94.5 2.4 5.2E-05 43.6 16.9 108 69-177 147-277 (765)
411 PRK13684 Ycf48-like protein; P 94.4 1.5 3.2E-05 40.2 14.0 120 52-174 176-329 (334)
412 PF07569 Hira: TUP1-like enhan 94.3 0.3 6.5E-06 41.8 8.6 28 75-102 18-45 (219)
413 PF14727 PHTB1_N: PTHB1 N-term 94.3 3 6.5E-05 39.3 15.7 136 78-219 36-200 (418)
414 PF05694 SBP56: 56kDa selenium 94.3 0.4 8.7E-06 44.7 9.7 92 88-179 221-345 (461)
415 PF13449 Phytase-like: Esteras 94.0 4.6 0.0001 36.9 16.3 142 69-211 21-232 (326)
416 PF00780 CNH: CNH domain; Int 94.0 4.1 8.9E-05 35.9 17.8 108 69-178 37-167 (275)
417 KOG2444 WD40 repeat protein [G 93.9 0.23 4.9E-06 41.9 6.6 62 78-139 113-177 (238)
418 PF07569 Hira: TUP1-like enhan 93.7 0.44 9.4E-06 40.8 8.4 57 117-174 18-93 (219)
419 KOG2280 Vacuolar assembly/sort 93.5 3.6 7.9E-05 40.9 15.0 98 70-171 46-150 (829)
420 PRK10115 protease 2; Provision 93.3 5.5 0.00012 40.5 16.7 105 69-175 128-254 (686)
421 PF14583 Pectate_lyase22: Olig 93.2 1.6 3.5E-05 40.3 11.6 86 72-157 40-131 (386)
422 PF10313 DUF2415: Uncharacteri 93.0 0.36 7.8E-06 29.3 4.8 30 69-98 2-34 (43)
423 PHA03098 kelch-like protein; P 93.0 3.5 7.5E-05 40.5 14.7 64 78-142 342-417 (534)
424 KOG4441 Proteins containing BT 92.9 1.6 3.4E-05 43.2 12.0 132 78-217 284-440 (571)
425 PF12657 TFIIIC_delta: Transcr 92.5 1.2 2.6E-05 36.6 9.0 31 195-225 87-123 (173)
426 KOG1897 Damage-specific DNA bi 92.4 9 0.0002 39.5 16.2 145 69-219 716-894 (1096)
427 PLN00033 photosystem II stabil 92.4 6.2 0.00014 37.1 14.6 118 52-173 242-396 (398)
428 PF14655 RAB3GAP2_N: Rab3 GTPa 92.3 1.4 3.1E-05 41.3 10.3 42 69-110 309-350 (415)
429 PF12657 TFIIIC_delta: Transcr 92.3 0.69 1.5E-05 37.9 7.5 27 149-175 86-120 (173)
430 COG3204 Uncharacterized protei 92.2 3.9 8.4E-05 36.2 11.9 115 107-222 83-209 (316)
431 PHA02713 hypothetical protein; 92.0 3.1 6.7E-05 41.1 12.8 65 78-142 303-378 (557)
432 TIGR03606 non_repeat_PQQ dehyd 92.0 12 0.00026 35.8 17.6 59 63-121 25-90 (454)
433 PF07995 GSDH: Glucose / Sorbo 91.9 9.9 0.00021 34.8 16.1 96 70-166 4-133 (331)
434 COG4257 Vgb Streptogramin lyas 91.9 8.4 0.00018 33.9 14.8 164 52-222 65-261 (353)
435 PF05096 Glu_cyclase_2: Glutam 91.6 8.9 0.00019 33.6 17.6 120 85-209 106-246 (264)
436 PF08728 CRT10: CRT10; InterP 91.5 11 0.00024 37.9 15.7 99 120-220 113-243 (717)
437 KOG4499 Ca2+-binding protein R 91.3 1.4 3.1E-05 37.6 8.0 48 71-118 215-262 (310)
438 PHA02790 Kelch-like protein; P 91.1 5.7 0.00012 38.5 13.4 130 78-214 318-456 (480)
439 COG3823 Glutamine cyclotransfe 90.9 3.8 8.3E-05 34.4 10.0 98 78-175 55-157 (262)
440 TIGR03075 PQQ_enz_alc_DH PQQ-d 90.9 3 6.4E-05 40.9 11.3 60 88-148 440-499 (527)
441 PF11715 Nup160: Nucleoporin N 90.7 1.1 2.5E-05 44.1 8.3 71 77-147 156-256 (547)
442 PF14761 HPS3_N: Hermansky-Pud 90.2 10 0.00023 32.0 12.7 96 80-176 29-163 (215)
443 PF05694 SBP56: 56kDa selenium 90.1 17 0.00037 34.3 17.8 145 76-221 138-340 (461)
444 PF07995 GSDH: Glucose / Sorbo 90.0 4.3 9.3E-05 37.2 11.0 46 112-159 4-59 (331)
445 PRK13615 lipoprotein LpqB; Pro 89.6 9.7 0.00021 37.4 13.4 96 113-211 337-434 (557)
446 TIGR02276 beta_rpt_yvtn 40-res 89.0 2.4 5.2E-05 25.1 5.9 38 119-156 1-41 (42)
447 COG5167 VID27 Protein involved 88.9 5.2 0.00011 38.1 10.4 104 72-176 513-632 (776)
448 TIGR03074 PQQ_membr_DH membran 88.8 13 0.00028 38.2 14.2 69 79-147 194-286 (764)
449 PF14269 Arylsulfotran_2: Aryl 88.5 5.5 0.00012 35.9 10.3 71 69-139 145-220 (299)
450 KOG1916 Nuclear protein, conta 88.4 0.43 9.4E-06 48.0 3.3 66 72-138 188-264 (1283)
451 KOG1900 Nuclear pore complex, 88.3 16 0.00034 39.0 14.3 147 86-232 96-282 (1311)
452 PHA02790 Kelch-like protein; P 88.2 9.8 0.00021 36.8 12.6 98 78-178 271-386 (480)
453 PHA03098 kelch-like protein; P 88.1 9.3 0.0002 37.5 12.5 98 78-178 294-416 (534)
454 KOG2247 WD40 repeat-containing 88.0 0.071 1.5E-06 49.8 -2.1 118 48-165 34-177 (615)
455 PF08728 CRT10: CRT10; InterP 88.0 9.4 0.0002 38.4 12.2 106 69-175 102-245 (717)
456 PF14781 BBS2_N: Ciliary BBSom 88.0 11 0.00024 29.3 11.2 64 115-178 4-83 (136)
457 KOG3616 Selective LIM binding 88.0 1.4 3E-05 43.7 6.3 66 109-174 14-81 (1636)
458 COG5290 IkappaB kinase complex 87.9 2 4.3E-05 43.0 7.3 103 112-219 249-363 (1243)
459 TIGR03075 PQQ_enz_alc_DH PQQ-d 87.6 20 0.00044 35.2 14.3 98 79-178 69-191 (527)
460 TIGR03606 non_repeat_PQQ dehyd 87.4 22 0.00049 34.0 13.9 51 109-159 29-89 (454)
461 KOG2280 Vacuolar assembly/sort 87.2 8.8 0.00019 38.4 11.2 79 130-212 63-146 (829)
462 TIGR03032 conserved hypothetic 87.1 10 0.00023 34.0 10.7 65 59-127 194-258 (335)
463 PRK13615 lipoprotein LpqB; Pro 86.5 17 0.00037 35.7 12.9 136 71-212 337-488 (557)
464 KOG1916 Nuclear protein, conta 86.4 0.93 2E-05 45.8 4.3 70 75-144 243-328 (1283)
465 PRK13614 lipoprotein LpqB; Pro 86.3 28 0.0006 34.5 14.3 130 85-216 317-457 (573)
466 TIGR02276 beta_rpt_yvtn 40-res 86.2 4.4 9.6E-05 23.8 5.9 31 77-107 1-32 (42)
467 PRK13614 lipoprotein LpqB; Pro 85.0 27 0.00058 34.6 13.5 142 69-213 344-505 (573)
468 COG1520 FOG: WD40-like repeat 84.6 11 0.00024 34.9 10.6 98 80-178 69-173 (370)
469 KOG2247 WD40 repeat-containing 84.4 0.15 3.2E-06 47.8 -2.0 108 112-225 37-149 (615)
470 PF12768 Rax2: Cortical protei 84.0 16 0.00034 32.6 10.6 87 88-174 15-121 (281)
471 KOG3522 Predicted guanine nucl 83.6 3.4 7.4E-05 41.6 6.7 132 80-216 548-691 (925)
472 KOG2377 Uncharacterized conser 83.3 42 0.00092 31.8 13.4 95 69-165 68-173 (657)
473 PF14269 Arylsulfotran_2: Aryl 83.1 32 0.00069 31.0 12.4 64 112-175 146-219 (299)
474 PF03088 Str_synth: Strictosid 83.0 11 0.00023 27.1 7.5 42 85-127 33-74 (89)
475 TIGR03118 PEPCTERM_chp_1 conse 83.0 35 0.00076 30.6 16.5 107 69-175 24-169 (336)
476 PF05935 Arylsulfotrans: Aryls 82.3 36 0.00079 32.9 13.3 53 73-128 153-208 (477)
477 PF07676 PD40: WD40-like Beta 82.1 5.8 0.00013 23.1 5.0 29 108-136 7-38 (39)
478 COG5276 Uncharacterized conser 81.6 39 0.00084 30.2 17.6 137 69-212 88-232 (370)
479 PRK13613 lipoprotein LpqB; Pro 81.5 42 0.00091 33.5 13.5 141 69-213 364-526 (599)
480 COG4590 ABC-type uncharacteriz 80.3 14 0.00031 34.8 9.0 100 79-178 280-388 (733)
481 TIGR03548 mutarot_permut cycli 79.1 38 0.00083 30.6 11.8 52 90-142 140-197 (323)
482 smart00564 PQQ beta-propeller 78.9 5.1 0.00011 22.2 3.9 26 80-105 7-32 (33)
483 PF10214 Rrn6: RNA polymerase 78.8 21 0.00045 36.9 10.8 109 69-178 81-234 (765)
484 PF03088 Str_synth: Strictosid 78.2 19 0.00041 25.9 7.4 41 127-167 33-76 (89)
485 PRK13613 lipoprotein LpqB; Pro 78.1 41 0.00088 33.6 12.2 108 101-212 353-473 (599)
486 TIGR03032 conserved hypothetic 77.9 31 0.00067 31.1 10.1 44 120-165 212-258 (335)
487 TIGR02608 delta_60_rpt delta-6 77.9 8.9 0.00019 24.7 5.1 16 71-86 4-19 (55)
488 PF13449 Phytase-like: Esteras 77.2 44 0.00094 30.5 11.5 105 109-215 19-168 (326)
489 PF07250 Glyoxal_oxid_N: Glyox 77.1 25 0.00054 30.6 9.3 126 91-216 48-192 (243)
490 PF14761 HPS3_N: Hermansky-Pud 77.0 14 0.0003 31.3 7.3 59 151-214 20-80 (215)
491 KOG3616 Selective LIM binding 76.0 7.4 0.00016 38.9 6.2 64 69-137 16-81 (1636)
492 KOG1898 Splicing factor 3b, su 75.4 1.1E+02 0.0025 32.2 15.0 146 69-220 879-1045(1205)
493 smart00564 PQQ beta-propeller 75.2 8.1 0.00017 21.3 4.0 24 123-146 8-31 (33)
494 KOG4460 Nuclear pore complex, 74.9 36 0.00078 32.9 10.1 35 69-103 167-204 (741)
495 PF11715 Nup160: Nucleoporin N 74.0 7.4 0.00016 38.3 6.0 38 70-107 217-258 (547)
496 TIGR03547 muta_rot_YjhT mutatr 73.8 72 0.0016 29.1 12.7 41 89-130 168-210 (346)
497 PF01011 PQQ: PQQ enzyme repea 72.6 10 0.00023 22.0 4.2 27 81-107 2-28 (38)
498 KOG1520 Predicted alkaloid syn 71.5 86 0.0019 29.0 13.4 57 167-229 198-256 (376)
499 KOG1897 Damage-specific DNA bi 71.1 1.4E+02 0.0031 31.3 17.9 120 54-174 465-611 (1096)
500 PLN02193 nitrile-specifier pro 70.9 97 0.0021 29.9 12.7 63 79-142 229-305 (470)
No 1
>KOG1272 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=100.00 E-value=5.5e-55 Score=384.04 Aligned_cols=345 Identities=43% Similarity=0.674 Sum_probs=294.8
Q ss_pred HHHHh-hhcCCc-----ccchhhhcccchhHHHHHHHHHHHhHhhhhccc------------------------------
Q 040274 8 TKVKK-YLRGED-----FKRQKLKGQLPLREELYGKSAKAAAKVEKNLVH------------------------------ 51 (359)
Q Consensus 8 ~~~~k-~~r~~~-----~~~~~lr~~~~~~~~~~~~a~~~~~~~e~ll~~------------------------------ 51 (359)
.+.++ |.||+. .++|++|.+++..+..|..+..+++++|+|+++
T Consensus 40 ~k~~r~y~r~~k~n~~~~k~K~~r~~lk~~e~~~e~a~~~aAk~e~Ll~e~~G~le~e~~EkT~~v~Q~~Ia~~Vdi~sa 119 (545)
T KOG1272|consen 40 NKFERIYSRGEKLNPKKMKDKKLREQLKVIEKIYEEAHEAAAKTEILLPETAGYLEAEGLEKTYKVRQDDIAENVDIASA 119 (545)
T ss_pred hhhcccccccccCChhhhhHHHHHHHHHHHHHHHHHHHHHHhhhceeccccCCcccccCCcceeeeEHhhhhhhccHHhH
Confidence 44444 888988 899999999999999999999999999999988
Q ss_pred -------------eEEEECCCCCEEEEecc--------------------------------------------------
Q 040274 52 -------------ILWILPSSGRYMAVAGR-------------------------------------------------- 68 (359)
Q Consensus 52 -------------~~l~~spdg~~l~~~~~-------------------------------------------------- 68 (359)
|.+.++.+|++|+.||+
T Consensus 120 ~k~f~L~l~eFGPY~~~ytrnGrhlllgGrKGHlAa~Dw~t~~L~~Ei~v~Etv~Dv~~LHneq~~AVAQK~y~yvYD~~ 199 (545)
T KOG1272|consen 120 TKHFDLSLPEFGPYHLDYTRNGRHLLLGGRKGHLAAFDWVTKKLHFEINVMETVRDVTFLHNEQFFAVAQKKYVYVYDNN 199 (545)
T ss_pred HhhccccccccCCeeeeecCCccEEEecCCccceeeeecccceeeeeeehhhhhhhhhhhcchHHHHhhhhceEEEecCC
Confidence 78888999999999998
Q ss_pred -----------------------------------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEe
Q 040274 69 -----------------------------------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWK 95 (359)
Q Consensus 69 -----------------------------------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd 95 (359)
.+..|+.+|.+..+.+|+.+|+|.+|.
T Consensus 200 GtElHClk~~~~v~rLeFLPyHfLL~~~~~~G~L~Y~DVS~GklVa~~~t~~G~~~vm~qNP~NaVih~GhsnGtVSlWS 279 (545)
T KOG1272|consen 200 GTELHCLKRHIRVARLEFLPYHFLLVAASEAGFLKYQDVSTGKLVASIRTGAGRTDVMKQNPYNAVIHLGHSNGTVSLWS 279 (545)
T ss_pred CcEEeehhhcCchhhhcccchhheeeecccCCceEEEeechhhhhHHHHccCCccchhhcCCccceEEEcCCCceEEecC
Confidence 788999999999999999999999999
Q ss_pred CCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCCcEEEEcCCcEEEE
Q 040274 96 PTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKGLLAVGTGSFAQIL 173 (359)
Q Consensus 96 ~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~gl~~~~~d~~i~v~ 173 (359)
+.+.+++..+.+|.++|.+++++++|+|++|+|.|..|+|||+++...++++ +-++..+++|..|+++++.+..|.||
T Consensus 280 P~skePLvKiLcH~g~V~siAv~~~G~YMaTtG~Dr~~kIWDlR~~~ql~t~~tp~~a~~ls~SqkglLA~~~G~~v~iw 359 (545)
T KOG1272|consen 280 PNSKEPLVKILCHRGPVSSIAVDRGGRYMATTGLDRKVKIWDLRNFYQLHTYRTPHPASNLSLSQKGLLALSYGDHVQIW 359 (545)
T ss_pred CCCcchHHHHHhcCCCcceEEECCCCcEEeecccccceeEeeeccccccceeecCCCccccccccccceeeecCCeeeee
Confidence 9999999999999999999999999999999999999999999998877777 45678999999999999999999999
Q ss_pred cCCCC--CccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCCCceeeeccCCCCChhhhhhHHHHHh
Q 040274 174 GDFSG--SHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSEPNFDSWVANPFETSKQRREKEVHSL 251 (359)
Q Consensus 174 d~~~~--~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~~~~~~~~~~~~~~~~~~~e~ev~~l 251 (359)
..... +....+|+.|.. +..|..+.|+|..++|.+|+..|+.+|++||+||+|++.|+.|||++.+||+|.||++|
T Consensus 360 ~d~~~~s~~~~~pYm~H~~--~~~V~~l~FcP~EDvLGIGH~~G~tsilVPGsGePN~Ds~e~nPfetrKQRqE~EVr~L 437 (545)
T KOG1272|consen 360 KDALKGSGHGETPYMNHRC--GGPVEDLRFCPYEDVLGIGHAGGITSILVPGSGEPNYDSLEDNPFETRKQRQEKEVRSL 437 (545)
T ss_pred hhhhcCCCCCCcchhhhcc--CcccccceeccHHHeeeccccCCceeEeccCCCCCCcchhccCcchhhhHHhHHHHHHH
Confidence 75433 355678888875 44899999999999999999999999999999999999999999999999999999999
Q ss_pred hhccCCCeeeeCCCCcccccccccccCCchhhhhhHHHHHHHhhcccccccccCCCCchhhhHHhhhhhHhhccchhHHH
Q 040274 252 LDKLLLETIMLNPSKIGTVREAKKKEKPTKQGREAEMEAAVEAIKGFVWKNKTKGRNKPSKKAKKKQELIAHARRPFLDQ 331 (359)
Q Consensus 252 l~~~~~~~i~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~k~k~~g~~~~~~~~~~k~~~~~~~~~~~~~~ 331 (359)
|+++||++|++||+.|+.++....+..+.+.+. .-...+.+.....+.|++||++..+ .++++||+++.|.++++
T Consensus 438 LeKippElIsLdp~~i~~vd~~~~~~~k~e~~~---~~~~~~~~~~~~pr~K~Kgr~s~~k--~k~~knvvd~~r~~ve~ 512 (545)
T KOG1272|consen 438 LEKIPPELISLDPRVIGIVDEPSLEEKKDEIER---LFEEKPPEAGALPRHKTKGRNSGAK--RKKKKNVVDDARLFVEQ 512 (545)
T ss_pred HhhCChHhEEechhhccccCcccchhhHHHHHH---HhcccCcccccCchhhhccCCchHH--HHHHHHHHHHHHHHHHH
Confidence 999999999999999999998776665322221 1123333445567888999999888 33345777887999999
Q ss_pred HHHHHHHHHHh--hhcc-ccccccccccCCC
Q 040274 332 QLKEEQSLSKK--KQKL-FEEVELPASLRRF 359 (359)
Q Consensus 332 ~~~~~~~~~~~--~~~~-~~~~~~~~~l~~~ 359 (359)
.+++++++..- +.+. .+..+.+.|||||
T Consensus 513 ~le~~k~~q~~~~~~~~~~ea~k~~~aLdRf 543 (545)
T KOG1272|consen 513 SLEKEKRKQAVKKEQGVKDEAAKKPSALDRF 543 (545)
T ss_pred HHHHHHHHHHHHHhhcCCcccccchhHHHhh
Confidence 98766644431 1221 2344559999999
No 2
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=99.97 E-value=1.3e-29 Score=221.71 Aligned_cols=165 Identities=18% Similarity=0.261 Sum_probs=152.3
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h 108 (359)
-.++|+|+|++|++++. .|.+++|+|||.+++||+.|..-+|||++++.++..+.+|
T Consensus 265 s~VafHPsG~~L~TasfD~tWRlWD~~tk~ElL~QEGHs~~v~~iaf~~DGSL~~tGGlD~~~RvWDlRtgr~im~L~gH 344 (459)
T KOG0272|consen 265 SRVAFHPSGKFLGTASFDSTWRLWDLETKSELLLQEGHSKGVFSIAFQPDGSLAATGGLDSLGRVWDLRTGRCIMFLAGH 344 (459)
T ss_pred eeeeecCCCceeeecccccchhhcccccchhhHhhcccccccceeEecCCCceeeccCccchhheeecccCcEEEEeccc
Confidence 78999999999999987 8999999999999999999999999999999999999999
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecCC---ceeEEEcCC-C--cEEEEcCCcEEEEcCCCCCccc
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTGH---AKTLDFSQK-G--LLAVGTGSFAQILGDFSGSHNY 182 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~~---v~~~~~s~~-g--l~~~~~d~~i~v~d~~~~~~~~ 182 (359)
..+|.+++|+|+|..|||||.|++++|||++.-..++++++| |+.+.|+|. | ++++++|+++.||. ..+..+.
T Consensus 345 ~k~I~~V~fsPNGy~lATgs~Dnt~kVWDLR~r~~ly~ipAH~nlVS~Vk~~p~~g~fL~TasyD~t~kiWs-~~~~~~~ 423 (459)
T KOG0272|consen 345 IKEILSVAFSPNGYHLATGSSDNTCKVWDLRMRSELYTIPAHSNLVSQVKYSPQEGYFLVTASYDNTVKIWS-TRTWSPL 423 (459)
T ss_pred ccceeeEeECCCceEEeecCCCCcEEEeeecccccceecccccchhhheEecccCCeEEEEcccCcceeeec-CCCcccc
Confidence 999999999999999999999999999999998889999766 799999994 4 88999999999998 4555777
Q ss_pred cccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 183 SRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 183 ~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
..+.+|.. .|.++.++|++.++++++.|.++.+|.
T Consensus 424 ksLaGHe~----kV~s~Dis~d~~~i~t~s~DRT~KLW~ 458 (459)
T KOG0272|consen 424 KSLAGHEG----KVISLDISPDSQAIATSSFDRTIKLWR 458 (459)
T ss_pred hhhcCCcc----ceEEEEeccCCceEEEeccCceeeecc
Confidence 88888866 899999999999999999998777774
No 3
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=99.96 E-value=2.5e-29 Score=219.87 Aligned_cols=151 Identities=22% Similarity=0.293 Sum_probs=133.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
.|..++|||+|.+|+|++.|.+-++||+.++..+....||...|.+++|+|||.+++|||.|..-+|||+|+|.++..+.
T Consensus 263 RVs~VafHPsG~~L~TasfD~tWRlWD~~tk~ElL~QEGHs~~v~~iaf~~DGSL~~tGGlD~~~RvWDlRtgr~im~L~ 342 (459)
T KOG0272|consen 263 RVSRVAFHPSGKFLGTASFDSTWRLWDLETKSELLLQEGHSKGVFSIAFQPDGSLAATGGLDSLGRVWDLRTGRCIMFLA 342 (459)
T ss_pred hheeeeecCCCceeeecccccchhhcccccchhhHhhcccccccceeEecCCCceeeccCccchhheeecccCcEEEEec
Confidence 78888888888888888888888888888888777778999999999999999999999999999999999999999996
Q ss_pred CC---ceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEcc-CCCEEEEEeCCCeEEEEEc
Q 040274 149 GH---AKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRP-YEDVLGIGHSMGWSGILVP 222 (359)
Q Consensus 149 ~~---v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp-~~~~l~~g~~dg~~~i~~~ 222 (359)
+| |.+++|||+| +++||.|++++|||++.. .....++.|.. -|+.++|+| .|.+|++++.|+.+.||.+
T Consensus 343 gH~k~I~~V~fsPNGy~lATgs~Dnt~kVWDLR~r-~~ly~ipAH~n----lVS~Vk~~p~~g~fL~TasyD~t~kiWs~ 417 (459)
T KOG0272|consen 343 GHIKEILSVAFSPNGYHLATGSSDNTCKVWDLRMR-SELYTIPAHSN----LVSQVKYSPQEGYFLVTASYDNTVKIWST 417 (459)
T ss_pred ccccceeeEeECCCceEEeecCCCCcEEEeeeccc-ccceecccccc----hhhheEecccCCeEEEEcccCcceeeecC
Confidence 65 7999999999 888999999999997655 45667777754 899999999 7899999999998888754
Q ss_pred CC
Q 040274 223 RS 224 (359)
Q Consensus 223 gs 224 (359)
-+
T Consensus 418 ~~ 419 (459)
T KOG0272|consen 418 RT 419 (459)
T ss_pred CC
Confidence 43
No 4
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=99.96 E-value=1.1e-28 Score=213.36 Aligned_cols=180 Identities=18% Similarity=0.345 Sum_probs=154.7
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcce-EEeec
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALL-IKMLY 107 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~-~~~~~ 107 (359)
.|+.|+|+|.+|++|+. .|.|++|+|||..|++|+.||+|++||+.+++++ ..|.+
T Consensus 119 l~~~fsp~g~~l~tGsGD~TvR~WD~~TeTp~~t~KgH~~WVlcvawsPDgk~iASG~~dg~I~lwdpktg~~~g~~l~g 198 (480)
T KOG0271|consen 119 LSVQFSPTGSRLVTGSGDTTVRLWDLDTETPLFTCKGHKNWVLCVAWSPDGKKIASGSKDGSIRLWDPKTGQQIGRALRG 198 (480)
T ss_pred EEEEecCCCceEEecCCCceEEeeccCCCCcceeecCCccEEEEEEECCCcchhhccccCCeEEEecCCCCCcccccccC
Confidence 89999999999999987 7999999999999999999999999999998765 45889
Q ss_pred CCCCeEEEEEec-----CCCEEEEecCCCeEEEEEcCCCeeeEeecC---CceeEEEcCCC-cEEEEcCCcEEEEcCCCC
Q 040274 108 HQGPVSALAFHP-----NGHLMATTGKECKIKIWDLRKYEVLQTLTG---HAKTLDFSQKG-LLAVGTGSFAQILGDFSG 178 (359)
Q Consensus 108 h~~~v~~l~~~p-----~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~---~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~ 178 (359)
|...|++++|.| ..++|++++.||+|+|||+..+.++..+.+ +|+|+.|..+| +++++.|++|++|+...+
T Consensus 199 H~K~It~Lawep~hl~p~~r~las~skDg~vrIWd~~~~~~~~~lsgHT~~VTCvrwGG~gliySgS~DrtIkvw~a~dG 278 (480)
T KOG0271|consen 199 HKKWITALAWEPLHLVPPCRRLASSSKDGSVRIWDTKLGTCVRTLSGHTASVTCVRWGGEGLIYSGSQDRTIKVWRALDG 278 (480)
T ss_pred cccceeEEeecccccCCCccceecccCCCCEEEEEccCceEEEEeccCccceEEEEEcCCceEEecCCCceEEEEEccch
Confidence 999999999987 677999999999999999999999888855 48999999999 888999999999985432
Q ss_pred --------------------------------C----------------------------------------------c
Q 040274 179 --------------------------------S----------------------------------------------H 180 (359)
Q Consensus 179 --------------------------------~----------------------------------------------~ 180 (359)
+ +
T Consensus 279 ~~~r~lkGHahwvN~lalsTdy~LRtgaf~~t~~~~~~~se~~~~Al~rY~~~~~~~~erlVSgsDd~tlflW~p~~~kk 358 (480)
T KOG0271|consen 279 KLCRELKGHAHWVNHLALSTDYVLRTGAFDHTGRKPKSFSEEQKKALERYEAVLKDSGERLVSGSDDFTLFLWNPFKSKK 358 (480)
T ss_pred hHHHhhcccchheeeeeccchhhhhccccccccccCCChHHHHHHHHHHHHHhhccCcceeEEecCCceEEEeccccccc
Confidence 0 0
Q ss_pred cccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE------------------------------EEcCCCCCcee
Q 040274 181 NYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI------------------------------LVPRSSEPNFD 230 (359)
Q Consensus 181 ~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i------------------------------~~~gs~~~~~~ 230 (359)
++....+ |..-|+.+.||||++++++++.|..+.+ +++|+-|.+++
T Consensus 359 pi~rmtg----Hq~lVn~V~fSPd~r~IASaSFDkSVkLW~g~tGk~lasfRGHv~~VYqvawsaDsRLlVS~SkDsTLK 434 (480)
T KOG0271|consen 359 PITRMTG----HQALVNHVSFSPDGRYIASASFDKSVKLWDGRTGKFLASFRGHVAAVYQVAWSADSRLLVSGSKDSTLK 434 (480)
T ss_pred chhhhhc----hhhheeeEEECCCccEEEEeecccceeeeeCCCcchhhhhhhccceeEEEEeccCccEEEEcCCCceEE
Confidence 0011122 3347999999999999999999998776 68889999999
Q ss_pred eeccC
Q 040274 231 SWVAN 235 (359)
Q Consensus 231 ~~~~~ 235 (359)
+|++.
T Consensus 435 vw~V~ 439 (480)
T KOG0271|consen 435 VWDVR 439 (480)
T ss_pred EEEee
Confidence 99874
No 5
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=99.96 E-value=3.2e-27 Score=197.99 Aligned_cols=153 Identities=18% Similarity=0.252 Sum_probs=131.6
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCCCeeeEee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHP-NGHLMATTGKECKIKIWDLRKYEVLQTL 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~~~~~~~~ 147 (359)
.+.|+.|-+ ...|+|||.|.+..+||+.+++.+..|.+|.+.|.+++++| +++.|++|+-|...++||+|.+.++++|
T Consensus 147 ylScC~f~d-D~~ilT~SGD~TCalWDie~g~~~~~f~GH~gDV~slsl~p~~~ntFvSg~cD~~aklWD~R~~~c~qtF 225 (343)
T KOG0286|consen 147 YLSCCRFLD-DNHILTGSGDMTCALWDIETGQQTQVFHGHTGDVMSLSLSPSDGNTFVSGGCDKSAKLWDVRSGQCVQTF 225 (343)
T ss_pred eeEEEEEcC-CCceEecCCCceEEEEEcccceEEEEecCCcccEEEEecCCCCCCeEEecccccceeeeeccCcceeEee
Confidence 577788876 44777888889999999999999999999999999999999 9999999999999999999999999999
Q ss_pred cCC---ceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEc
Q 040274 148 TGH---AKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVP 222 (359)
Q Consensus 148 ~~~---v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~ 222 (359)
.+| |+++.|.|+| +++++.|+++++||++.. ..+..|... . ...+|++++||-.|++|.+|..|..+.+|.+
T Consensus 226 ~ghesDINsv~ffP~G~afatGSDD~tcRlyDlRaD-~~~a~ys~~-~-~~~gitSv~FS~SGRlLfagy~d~~c~vWDt 302 (343)
T KOG0286|consen 226 EGHESDINSVRFFPSGDAFATGSDDATCRLYDLRAD-QELAVYSHD-S-IICGITSVAFSKSGRLLFAGYDDFTCNVWDT 302 (343)
T ss_pred cccccccceEEEccCCCeeeecCCCceeEEEeecCC-cEEeeeccC-c-ccCCceeEEEcccccEEEeeecCCceeEeec
Confidence 655 8999999999 889999999999998765 444444432 2 3447999999999999999999998888654
Q ss_pred CCC
Q 040274 223 RSS 225 (359)
Q Consensus 223 gs~ 225 (359)
-.+
T Consensus 303 lk~ 305 (343)
T KOG0286|consen 303 LKG 305 (343)
T ss_pred ccc
Confidence 433
No 6
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=99.95 E-value=2.4e-27 Score=221.97 Aligned_cols=166 Identities=19% Similarity=0.263 Sum_probs=153.8
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h 108 (359)
|...|+|+.++|++|+. +|+++.|+|.|-+|+||+.|++-++|......+++.|.+|
T Consensus 455 yg~sFsPd~rfLlScSED~svRLWsl~t~s~~V~y~GH~~PVwdV~F~P~GyYFatas~D~tArLWs~d~~~PlRifagh 534 (707)
T KOG0263|consen 455 YGCSFSPDRRFLLSCSEDSSVRLWSLDTWSCLVIYKGHLAPVWDVQFAPRGYYFATASHDQTARLWSTDHNKPLRIFAGH 534 (707)
T ss_pred eeeeecccccceeeccCCcceeeeecccceeEEEecCCCcceeeEEecCCceEEEecCCCceeeeeecccCCchhhhccc
Confidence 99999999999999987 8999999999999999999999999999999999999999
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecC---CceeEEEcCCC--cEEEEcCCcEEEEcCCCCCcccc
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTG---HAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYS 183 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~---~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~ 183 (359)
-+.|.|+.|+|+.+|++|||.|.+|++||+.+|..++.|.| +|.+++|||+| +++++.|+.|.+||+..+ ..+.
T Consensus 535 lsDV~cv~FHPNs~Y~aTGSsD~tVRlWDv~~G~~VRiF~GH~~~V~al~~Sp~Gr~LaSg~ed~~I~iWDl~~~-~~v~ 613 (707)
T KOG0263|consen 535 LSDVDCVSFHPNSNYVATGSSDRTVRLWDVSTGNSVRIFTGHKGPVTALAFSPCGRYLASGDEDGLIKIWDLANG-SLVK 613 (707)
T ss_pred ccccceEEECCcccccccCCCCceEEEEEcCCCcEEEEecCCCCceEEEEEcCCCceEeecccCCcEEEEEcCCC-cchh
Confidence 99999999999999999999999999999999999999954 58999999999 778888999999996654 6777
Q ss_pred ccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEc
Q 040274 184 RYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVP 222 (359)
Q Consensus 184 ~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~ 222 (359)
.+.+|.+ .|.++.||.+|.+|++|+.|..+++|..
T Consensus 614 ~l~~Ht~----ti~SlsFS~dg~vLasgg~DnsV~lWD~ 648 (707)
T KOG0263|consen 614 QLKGHTG----TIYSLSFSRDGNVLASGGADNSVRLWDL 648 (707)
T ss_pred hhhcccC----ceeEEEEecCCCEEEecCCCCeEEEEEc
Confidence 8888865 8999999999999999999988888743
No 7
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=99.95 E-value=2.5e-27 Score=221.86 Aligned_cols=162 Identities=17% Similarity=0.314 Sum_probs=149.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
+|..+.|+|+.++|+++|.|++|++|.+.+..++..+.+|..||+.+.|+|-|-||||+|.|++.++|......+++.+.
T Consensus 453 PVyg~sFsPd~rfLlScSED~svRLWsl~t~s~~V~y~GH~~PVwdV~F~P~GyYFatas~D~tArLWs~d~~~PlRifa 532 (707)
T KOG0263|consen 453 PVYGCSFSPDRRFLLSCSEDSSVRLWSLDTWSCLVIYKGHLAPVWDVQFAPRGYYFATASHDQTARLWSTDHNKPLRIFA 532 (707)
T ss_pred ceeeeeecccccceeeccCCcceeeeecccceeEEEecCCCcceeeEEecCCceEEEecCCCceeeeeecccCCchhhhc
Confidence 89999999999999999999999999999999999999999999999999999999999999999999999988998886
Q ss_pred CC---ceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE----
Q 040274 149 GH---AKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI---- 219 (359)
Q Consensus 149 ~~---v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i---- 219 (359)
+| |.|+.|+|+. ++++|.|.+|++||+.++ ..+..+.+|.. +|.+++|||+|++|++|+.||.+.+
T Consensus 533 ghlsDV~cv~FHPNs~Y~aTGSsD~tVRlWDv~~G-~~VRiF~GH~~----~V~al~~Sp~Gr~LaSg~ed~~I~iWDl~ 607 (707)
T KOG0263|consen 533 GHLSDVDCVSFHPNSNYVATGSSDRTVRLWDVSTG-NSVRIFTGHKG----PVTALAFSPCGRYLASGDEDGLIKIWDLA 607 (707)
T ss_pred ccccccceEEECCcccccccCCCCceEEEEEcCCC-cEEEEecCCCC----ceEEEEEcCCCceEeecccCCcEEEEEcC
Confidence 65 7899999999 777888999999997665 67888888865 9999999999999999999999877
Q ss_pred --------------------------EEcCCCCCceeeeccC
Q 040274 220 --------------------------LVPRSSEPNFDSWVAN 235 (359)
Q Consensus 220 --------------------------~~~gs~~~~~~~~~~~ 235 (359)
+++|++|+++++|+..
T Consensus 608 ~~~~v~~l~~Ht~ti~SlsFS~dg~vLasgg~DnsV~lWD~~ 649 (707)
T KOG0263|consen 608 NGSLVKQLKGHTGTIYSLSFSRDGNVLASGGADNSVRLWDLT 649 (707)
T ss_pred CCcchhhhhcccCceeEEEEecCCCEEEecCCCCeEEEEEch
Confidence 5778889999999864
No 8
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=99.94 E-value=3.1e-25 Score=185.01 Aligned_cols=169 Identities=19% Similarity=0.218 Sum_probs=145.9
Q ss_pred eEEEECCCCCEEEEecc------------------------ceeEEEEcCC--CCEEEEEeCCCeEEEEeCCCCcceEEe
Q 040274 52 ILWILPSSGRYMAVAGR------------------------RTDLMRVNPF--NGVVSLGHSGGTVTMWKPTTSALLIKM 105 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------~v~~l~~sp~--~~~l~tg~~dg~v~lwd~~~~~~~~~~ 105 (359)
.+++|+||.+.|++|++ .|+|++|+|. +.+|++++.|++|++||+++.+....+
T Consensus 109 lsva~s~dn~qivSGSrDkTiklwnt~g~ck~t~~~~~~~~WVscvrfsP~~~~p~Ivs~s~DktvKvWnl~~~~l~~~~ 188 (315)
T KOG0279|consen 109 LSVAFSTDNRQIVSGSRDKTIKLWNTLGVCKYTIHEDSHREWVSCVRFSPNESNPIIVSASWDKTVKVWNLRNCQLRTTF 188 (315)
T ss_pred EEEEecCCCceeecCCCcceeeeeeecccEEEEEecCCCcCcEEEEEEcCCCCCcEEEEccCCceEEEEccCCcchhhcc
Confidence 89999999999999998 6999999996 789999999999999999999999999
Q ss_pred ecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCC-cEEEEcCCcEEEEcCCCCCccc
Q 040274 106 LYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNY 182 (359)
Q Consensus 106 ~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~ 182 (359)
.+|++.++.++++|||.++++|+.||.+.+||++.++.+.++ ...|.+++|+|+- .++...+..|.|||+... ..+
T Consensus 189 ~gh~~~v~t~~vSpDGslcasGgkdg~~~LwdL~~~k~lysl~a~~~v~sl~fspnrywL~~at~~sIkIwdl~~~-~~v 267 (315)
T KOG0279|consen 189 IGHSGYVNTVTVSPDGSLCASGGKDGEAMLWDLNEGKNLYSLEAFDIVNSLCFSPNRYWLCAATATSIKIWDLESK-AVV 267 (315)
T ss_pred ccccccEEEEEECCCCCEEecCCCCceEEEEEccCCceeEeccCCCeEeeEEecCCceeEeeccCCceEEEeccch-hhh
Confidence 999999999999999999999999999999999999999998 4568999999999 777888888999997554 333
Q ss_pred ccccc-ccC----CCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 183 SRYMG-NSM----VKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 183 ~~~~~-~~~----~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
..+.- ..+ .......+++|++||..|+.|..|+.+++|-
T Consensus 268 ~~l~~d~~g~s~~~~~~~clslaws~dG~tLf~g~td~~irv~q 311 (315)
T KOG0279|consen 268 EELKLDGIGPSSKAGDPICLSLAWSADGQTLFAGYTDNVIRVWQ 311 (315)
T ss_pred hhccccccccccccCCcEEEEEEEcCCCcEEEeeecCCcEEEEE
Confidence 32211 111 0233577899999999999999999887774
No 9
>KOG0273 consensus Beta-transducin family (WD-40 repeat) protein [Chromatin structure and dynamics]
Probab=99.94 E-value=3.2e-25 Score=196.67 Aligned_cols=167 Identities=22% Similarity=0.333 Sum_probs=146.7
Q ss_pred eEEEECCCCCEEEEecc----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCc---------
Q 040274 52 ILWILPSSGRYMAVAGR----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSA--------- 100 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~--------- 100 (359)
.+|+|+.+|..||+|.. +|.++.|+..|.+|++++.|+++.|||..+++
T Consensus 239 T~L~Wn~~G~~LatG~~~G~~riw~~~G~l~~tl~~HkgPI~slKWnk~G~yilS~~vD~ttilwd~~~g~~~q~f~~~s 318 (524)
T KOG0273|consen 239 TSLDWNNDGTLLATGSEDGEARIWNKDGNLISTLGQHKGPIFSLKWNKKGTYILSGGVDGTTILWDAHTGTVKQQFEFHS 318 (524)
T ss_pred ceEEecCCCCeEEEeecCcEEEEEecCchhhhhhhccCCceEEEEEcCCCCEEEeccCCccEEEEeccCceEEEeeeecc
Confidence 99999999999999987 99999999999999999999999999974332
Q ss_pred --------------------------------ceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee-
Q 040274 101 --------------------------------LLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL- 147 (359)
Q Consensus 101 --------------------------------~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~- 147 (359)
|+.++.+|.++|+++.|+|.|.+|+|++.|++++||.+....+.+.+
T Consensus 319 ~~~lDVdW~~~~~F~ts~td~~i~V~kv~~~~P~~t~~GH~g~V~alk~n~tg~LLaS~SdD~TlkiWs~~~~~~~~~l~ 398 (524)
T KOG0273|consen 319 APALDVDWQSNDEFATSSTDGCIHVCKVGEDRPVKTFIGHHGEVNALKWNPTGSLLASCSDDGTLKIWSMGQSNSVHDLQ 398 (524)
T ss_pred CCccceEEecCceEeecCCCceEEEEEecCCCcceeeecccCceEEEEECCCCceEEEecCCCeeEeeecCCCcchhhhh
Confidence 55677899999999999999999999999999999998877666666
Q ss_pred --cCCceeEEEcCCC-----------cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 148 --TGHAKTLDFSQKG-----------LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 148 --~~~v~~~~~s~~g-----------l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
...|..+.|+|+| +++++.|++|.+||+..+ .++..++.|.. +|++++|+|+|++|++|+.|
T Consensus 399 ~Hskei~t~~wsp~g~v~~n~~~~~~l~sas~dstV~lwdv~~g-v~i~~f~kH~~----pVysvafS~~g~ylAsGs~d 473 (524)
T KOG0273|consen 399 AHSKEIYTIKWSPTGPVTSNPNMNLMLASASFDSTVKLWDVESG-VPIHTLMKHQE----PVYSVAFSPNGRYLASGSLD 473 (524)
T ss_pred hhccceeeEeecCCCCccCCCcCCceEEEeecCCeEEEEEccCC-ceeEeeccCCC----ceEEEEecCCCcEEEecCCC
Confidence 4457889999865 688999999999996554 67777877765 99999999999999999999
Q ss_pred CeEEEEEcC
Q 040274 215 GWSGILVPR 223 (359)
Q Consensus 215 g~~~i~~~g 223 (359)
|.+.||..-
T Consensus 474 g~V~iws~~ 482 (524)
T KOG0273|consen 474 GCVHIWSTK 482 (524)
T ss_pred CeeEecccc
Confidence 999998543
No 10
>KOG0284 consensus Polyadenylation factor I complex, subunit PFS2 [RNA processing and modification]
Probab=99.93 E-value=2e-25 Score=194.75 Aligned_cols=178 Identities=21% Similarity=0.354 Sum_probs=155.2
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeec-
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLY- 107 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~- 107 (359)
+.+.|+|+|+.|++|+. .|.+|.|++++.++++|+.+|.|.+|+++... +..+.+
T Consensus 100 ~~v~WtPeGRRLltgs~SGEFtLWNg~~fnFEtilQaHDs~Vr~m~ws~~g~wmiSgD~gG~iKyWqpnmnn-Vk~~~ah 178 (464)
T KOG0284|consen 100 NVVRWTPEGRRLLTGSQSGEFTLWNGTSFNFETILQAHDSPVRTMKWSHNGTWMISGDKGGMIKYWQPNMNN-VKIIQAH 178 (464)
T ss_pred eeEEEcCCCceeEeecccccEEEecCceeeHHHHhhhhcccceeEEEccCCCEEEEcCCCceEEecccchhh-hHHhhHh
Confidence 89999999999999987 89999999999999999999999999998654 444444
Q ss_pred CCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecCC---ceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccc
Q 040274 108 HQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTGH---AKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNY 182 (359)
Q Consensus 108 h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~~---v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~ 182 (359)
|...|++++|+|+...|+||+.||+|+|||....+.-..+.+| |.+++|+|.- ++++|.|+.|.+||.+++ ..+
T Consensus 179 h~eaIRdlafSpnDskF~t~SdDg~ikiWdf~~~kee~vL~GHgwdVksvdWHP~kgLiasgskDnlVKlWDprSg-~cl 257 (464)
T KOG0284|consen 179 HAEAIRDLAFSPNDSKFLTCSDDGTIKIWDFRMPKEERVLRGHGWDVKSVDWHPTKGLIASGSKDNLVKLWDPRSG-SCL 257 (464)
T ss_pred hhhhhheeccCCCCceeEEecCCCeEEEEeccCCchhheeccCCCCcceeccCCccceeEEccCCceeEeecCCCc-chh
Confidence 5599999999999999999999999999999988776666655 8999999986 777888999999996655 677
Q ss_pred cccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE-------------------------------EEcCCCCCceee
Q 040274 183 SRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI-------------------------------LVPRSSEPNFDS 231 (359)
Q Consensus 183 ~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i-------------------------------~~~gs~~~~~~~ 231 (359)
.++..|.. .|..+.|+|++++|++++.|..+.+ +.+|+.|+.+..
T Consensus 258 ~tlh~HKn----tVl~~~f~~n~N~Llt~skD~~~kv~DiR~mkEl~~~r~Hkkdv~~~~WhP~~~~lftsgg~Dgsvvh 333 (464)
T KOG0284|consen 258 ATLHGHKN----TVLAVKFNPNGNWLLTGSKDQSCKVFDIRTMKELFTYRGHKKDVTSLTWHPLNESLFTSGGSDGSVVH 333 (464)
T ss_pred hhhhhccc----eEEEEEEcCCCCeeEEccCCceEEEEehhHhHHHHHhhcchhhheeeccccccccceeeccCCCceEE
Confidence 77777754 8999999999999999999998765 678888999988
Q ss_pred eccC
Q 040274 232 WVAN 235 (359)
Q Consensus 232 ~~~~ 235 (359)
|.+.
T Consensus 334 ~~v~ 337 (464)
T KOG0284|consen 334 WVVG 337 (464)
T ss_pred Eecc
Confidence 8765
No 11
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=99.93 E-value=4.9e-24 Score=177.88 Aligned_cols=147 Identities=14% Similarity=0.198 Sum_probs=130.9
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee-
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL- 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~- 147 (359)
.|+.+..+++|+++++++.|+++++||+.++++...|.+|...|.+++|+||.+.+++|+.|.+|++||+-. .+..++
T Consensus 65 ~v~dv~~s~dg~~alS~swD~~lrlWDl~~g~~t~~f~GH~~dVlsva~s~dn~qivSGSrDkTiklwnt~g-~ck~t~~ 143 (315)
T KOG0279|consen 65 FVSDVVLSSDGNFALSASWDGTLRLWDLATGESTRRFVGHTKDVLSVAFSTDNRQIVSGSRDKTIKLWNTLG-VCKYTIH 143 (315)
T ss_pred EecceEEccCCceEEeccccceEEEEEecCCcEEEEEEecCCceEEEEecCCCceeecCCCcceeeeeeecc-cEEEEEe
Confidence 799999999999999999999999999999999999999999999999999999999999999999999874 454554
Q ss_pred ----cCCceeEEEcCCC----cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 148 ----TGHAKTLDFSQKG----LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 148 ----~~~v~~~~~s~~g----l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
.+.|+|+.|+|+. +++++.|++|++||+.+- +....+.+|.+ .++.+.+||||..+++|+.||.+.+
T Consensus 144 ~~~~~~WVscvrfsP~~~~p~Ivs~s~DktvKvWnl~~~-~l~~~~~gh~~----~v~t~~vSpDGslcasGgkdg~~~L 218 (315)
T KOG0279|consen 144 EDSHREWVSCVRFSPNESNPIIVSASWDKTVKVWNLRNC-QLRTTFIGHSG----YVNTVTVSPDGSLCASGGKDGEAML 218 (315)
T ss_pred cCCCcCcEEEEEEcCCCCCcEEEEccCCceEEEEccCCc-chhhccccccc----cEEEEEECCCCCEEecCCCCceEEE
Confidence 3458999999984 889999999999996544 56667777755 7999999999999999999998777
Q ss_pred EE
Q 040274 220 LV 221 (359)
Q Consensus 220 ~~ 221 (359)
|.
T Consensus 219 wd 220 (315)
T KOG0279|consen 219 WD 220 (315)
T ss_pred EE
Confidence 43
No 12
>KOG0284 consensus Polyadenylation factor I complex, subunit PFS2 [RNA processing and modification]
Probab=99.93 E-value=4.2e-25 Score=192.75 Aligned_cols=163 Identities=19% Similarity=0.292 Sum_probs=140.0
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h 108 (359)
.++.|+++|.++++|.. .|.+++|+|....|++++.||+|+|||....+....+.+|
T Consensus 142 r~m~ws~~g~wmiSgD~gG~iKyWqpnmnnVk~~~ahh~eaIRdlafSpnDskF~t~SdDg~ikiWdf~~~kee~vL~GH 221 (464)
T KOG0284|consen 142 RTMKWSHNGTWMISGDKGGMIKYWQPNMNNVKIIQAHHAEAIRDLAFSPNDSKFLTCSDDGTIKIWDFRMPKEERVLRGH 221 (464)
T ss_pred eeEEEccCCCEEEEcCCCceEEecccchhhhHHhhHhhhhhhheeccCCCCceeEEecCCCeEEEEeccCCchhheeccC
Confidence 89999999999999877 8999999998889999999999999999998888889999
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee---cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCcccc
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL---TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYS 183 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~---~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~ 183 (359)
.-.|.+++|+|.-.+++++|.|..|++||.+++.++.++ ...|..+.|+|++ |+++|.|..+.+||++.. +.+.
T Consensus 222 gwdVksvdWHP~kgLiasgskDnlVKlWDprSg~cl~tlh~HKntVl~~~f~~n~N~Llt~skD~~~kv~DiR~m-kEl~ 300 (464)
T KOG0284|consen 222 GWDVKSVDWHPTKGLIASGSKDNLVKLWDPRSGSCLATLHGHKNTVLAVKFNPNGNWLLTGSKDQSCKVFDIRTM-KELF 300 (464)
T ss_pred CCCcceeccCCccceeEEccCCceeEeecCCCcchhhhhhhccceEEEEEEcCCCCeeEEccCCceEEEEehhHh-HHHH
Confidence 999999999999999999999999999999999998888 4458999999999 889999999999997733 4455
Q ss_pred ccccccCCCCcceeEEEEcc-CCCEEEEEeCCCeEEE
Q 040274 184 RYMGNSMVKGYQIGKVSFRP-YEDVLGIGHSMGWSGI 219 (359)
Q Consensus 184 ~~~~~~~~~~~~v~~~~~sp-~~~~l~~g~~dg~~~i 219 (359)
.+.+|.. .|+++.|+| ...+|.+|+.||.+..
T Consensus 301 ~~r~Hkk----dv~~~~WhP~~~~lftsgg~Dgsvvh 333 (464)
T KOG0284|consen 301 TYRGHKK----DVTSLTWHPLNESLFTSGGSDGSVVH 333 (464)
T ss_pred Hhhcchh----hheeeccccccccceeeccCCCceEE
Confidence 5555543 567777777 3456666666665443
No 13
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=99.93 E-value=4.4e-24 Score=202.76 Aligned_cols=170 Identities=21% Similarity=0.293 Sum_probs=148.4
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeC-CCCcceEEe
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKP-TTSALLIKM 105 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~-~~~~~~~~~ 105 (359)
.++.|+|||++|++++. .|++++|+|++.++++|+.|++|++||+ ..+..+.++
T Consensus 163 ~~~~fs~~g~~l~~~~~~~~i~~~~~~~~~~~~~~~l~~h~~~v~~~~fs~d~~~l~s~s~D~tiriwd~~~~~~~~~~l 242 (456)
T KOG0266|consen 163 TCVDFSPDGRALAAASSDGLIRIWKLEGIKSNLLRELSGHTRGVSDVAFSPDGSYLLSGSDDKTLRIWDLKDDGRNLKTL 242 (456)
T ss_pred EEEEEcCCCCeEEEccCCCcEEEeecccccchhhccccccccceeeeEECCCCcEEEEecCCceEEEeeccCCCeEEEEe
Confidence 88999999999988755 7999999999999999999999999999 555888999
Q ss_pred ecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec---CCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCc
Q 040274 106 LYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT---GHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSH 180 (359)
Q Consensus 106 ~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~---~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~ 180 (359)
.+|...|++++|+|+|+++++|+.|++|+|||+++++++..+. +.|++++|+++| +++++.|+.|+|||+..+..
T Consensus 243 ~gH~~~v~~~~f~p~g~~i~Sgs~D~tvriWd~~~~~~~~~l~~hs~~is~~~f~~d~~~l~s~s~d~~i~vwd~~~~~~ 322 (456)
T KOG0266|consen 243 KGHSTYVTSVAFSPDGNLLVSGSDDGTVRIWDVRTGECVRKLKGHSDGISGLAFSPDGNLLVSASYDGTIRVWDLETGSK 322 (456)
T ss_pred cCCCCceEEEEecCCCCEEEEecCCCcEEEEeccCCeEEEeeeccCCceEEEEECCCCCEEEEcCCCccEEEEECCCCce
Confidence 9999999999999999999999999999999999999988884 458999999999 77788899999999766532
Q ss_pred -cccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 181 -NYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 181 -~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
....+..+.. .. +++++.|+|++.+|++++.|+.+.+|...
T Consensus 323 ~~~~~~~~~~~-~~-~~~~~~fsp~~~~ll~~~~d~~~~~w~l~ 364 (456)
T KOG0266|consen 323 LCLKLLSGAEN-SA-PVTSVQFSPNGKYLLSASLDRTLKLWDLR 364 (456)
T ss_pred eeeecccCCCC-CC-ceeEEEECCCCcEEEEecCCCeEEEEEcc
Confidence 2344455533 33 69999999999999999999988886544
No 14
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=99.93 E-value=2.7e-24 Score=180.46 Aligned_cols=147 Identities=16% Similarity=0.269 Sum_probs=133.4
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL 147 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~ 147 (359)
.|.+++++| +++.+++|+.|.+.+|||++.+.+.++|.+|.+.|+++.|.|+|.-|+||+.|+++++||+|..+.+..|
T Consensus 188 DV~slsl~p~~~ntFvSg~cD~~aklWD~R~~~c~qtF~ghesDINsv~ffP~G~afatGSDD~tcRlyDlRaD~~~a~y 267 (343)
T KOG0286|consen 188 DVMSLSLSPSDGNTFVSGGCDKSAKLWDVRSGQCVQTFEGHESDINSVRFFPSGDAFATGSDDATCRLYDLRADQELAVY 267 (343)
T ss_pred cEEEEecCCCCCCeEEecccccceeeeeccCcceeEeecccccccceEEEccCCCeeeecCCCceeEEEeecCCcEEeee
Confidence 899999999 8999999999999999999999999999999999999999999999999999999999999998888877
Q ss_pred c-----CCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEE
Q 040274 148 T-----GHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGIL 220 (359)
Q Consensus 148 ~-----~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~ 220 (359)
. .+|++++||-.| |+++..|.++.+||...+ +....+.+|.. .|+|+..+|||..+++|+.|.+++||
T Consensus 268 s~~~~~~gitSv~FS~SGRlLfagy~d~~c~vWDtlk~-e~vg~L~GHeN----RvScl~~s~DG~av~TgSWDs~lriW 342 (343)
T KOG0286|consen 268 SHDSIICGITSVAFSKSGRLLFAGYDDFTCNVWDTLKG-ERVGVLAGHEN----RVSCLGVSPDGMAVATGSWDSTLRIW 342 (343)
T ss_pred ccCcccCCceeEEEcccccEEEeeecCCceeEeecccc-ceEEEeeccCC----eeEEEEECCCCcEEEecchhHheeec
Confidence 3 458999999999 667777899999996554 56666677754 99999999999999999999888877
No 15
>KOG0645 consensus WD40 repeat protein [General function prediction only]
Probab=99.92 E-value=2.3e-23 Score=173.26 Aligned_cols=166 Identities=16% Similarity=0.252 Sum_probs=142.0
Q ss_pred eEEEECCC-CCEEEEecc---------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCC--cc
Q 040274 52 ILWILPSS-GRYMAVAGR---------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTS--AL 101 (359)
Q Consensus 52 ~~l~~spd-g~~l~~~~~---------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~--~~ 101 (359)
+.++|+|- |..|++||. .|.+++|+|.|++|++||.|.++.||.-..+ ++
T Consensus 18 W~~awhp~~g~ilAscg~Dk~vriw~~~~~~s~~ck~vld~~hkrsVRsvAwsp~g~~La~aSFD~t~~Iw~k~~~efec 97 (312)
T KOG0645|consen 18 WSVAWHPGKGVILASCGTDKAVRIWSTSSGDSWTCKTVLDDGHKRSVRSVAWSPHGRYLASASFDATVVIWKKEDGEFEC 97 (312)
T ss_pred EEEEeccCCceEEEeecCCceEEEEecCCCCcEEEEEeccccchheeeeeeecCCCcEEEEeeccceEEEeecCCCceeE
Confidence 89999998 999999987 7899999999999999999999999986644 67
Q ss_pred eEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC---CeeeEeecCC---ceeEEEcCCC--cEEEEcCCcEEEE
Q 040274 102 LIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRK---YEVLQTLTGH---AKTLDFSQKG--LLAVGTGSFAQIL 173 (359)
Q Consensus 102 ~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~---~~~~~~~~~~---v~~~~~s~~g--l~~~~~d~~i~v~ 173 (359)
+.++.||...|-|++|+++|+|||||+.|..|.||.+.. .+++..+..| |..+.|+|.. |+++++|++|++|
T Consensus 98 v~~lEGHEnEVK~Vaws~sG~~LATCSRDKSVWiWe~deddEfec~aVL~~HtqDVK~V~WHPt~dlL~S~SYDnTIk~~ 177 (312)
T KOG0645|consen 98 VATLEGHENEVKCVAWSASGNYLATCSRDKSVWIWEIDEDDEFECIAVLQEHTQDVKHVIWHPTEDLLFSCSYDNTIKVY 177 (312)
T ss_pred EeeeeccccceeEEEEcCCCCEEEEeeCCCeEEEEEecCCCcEEEEeeeccccccccEEEEcCCcceeEEeccCCeEEEE
Confidence 888999999999999999999999999999999999874 3455666544 7889999976 8899999999999
Q ss_pred cCCCC--CccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 174 GDFSG--SHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 174 d~~~~--~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
..... -.....+.+|.. .|.+++|+|.|..|++++.|+.++||.
T Consensus 178 ~~~~dddW~c~~tl~g~~~----TVW~~~F~~~G~rl~s~sdD~tv~Iw~ 223 (312)
T KOG0645|consen 178 RDEDDDDWECVQTLDGHEN----TVWSLAFDNIGSRLVSCSDDGTVSIWR 223 (312)
T ss_pred eecCCCCeeEEEEecCccc----eEEEEEecCCCceEEEecCCcceEeee
Confidence 84422 123445555543 899999999999999999999988854
No 16
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=99.92 E-value=6.1e-24 Score=174.66 Aligned_cols=166 Identities=17% Similarity=0.232 Sum_probs=139.9
Q ss_pred eEEEECCCCCEEEEecc------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeec
Q 040274 52 ILWILPSSGRYMAVAGR------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLY 107 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~ 107 (359)
..|.++||+++||.++. .|+++.|..+|.++++|+.||+++|||++...+...+ .
T Consensus 44 NrLeiTpdk~~LAaa~~qhvRlyD~~S~np~Pv~t~e~h~kNVtaVgF~~dgrWMyTgseDgt~kIWdlR~~~~qR~~-~ 122 (311)
T KOG0315|consen 44 NRLEITPDKKDLAAAGNQHVRLYDLNSNNPNPVATFEGHTKNVTAVGFQCDGRWMYTGSEDGTVKIWDLRSLSCQRNY-Q 122 (311)
T ss_pred eeEEEcCCcchhhhccCCeeEEEEccCCCCCceeEEeccCCceEEEEEeecCeEEEecCCCceEEEEeccCcccchhc-c
Confidence 78899999999999887 7999999999999999999999999999986655555 6
Q ss_pred CCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee----cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCc-
Q 040274 108 HQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL----TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSH- 180 (359)
Q Consensus 108 h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~----~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~- 180 (359)
|..+|+++..+|+...|++|..+|.|++||+....+...+ ...+.++...||| ++++...|++++|++.....
T Consensus 123 ~~spVn~vvlhpnQteLis~dqsg~irvWDl~~~~c~~~liPe~~~~i~sl~v~~dgsml~a~nnkG~cyvW~l~~~~~~ 202 (311)
T KOG0315|consen 123 HNSPVNTVVLHPNQTELISGDQSGNIRVWDLGENSCTHELIPEDDTSIQSLTVMPDGSMLAAANNKGNCYVWRLLNHQTA 202 (311)
T ss_pred CCCCcceEEecCCcceEEeecCCCcEEEEEccCCccccccCCCCCcceeeEEEcCCCcEEEEecCCccEEEEEccCCCcc
Confidence 7799999999999999999999999999999988776666 3468999999999 55555679999999765321
Q ss_pred ----cccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEc
Q 040274 181 ----NYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVP 222 (359)
Q Consensus 181 ----~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~ 222 (359)
++..+..|. ..+..+.+|||+.+|++++.|..+.||.+
T Consensus 203 s~l~P~~k~~ah~----~~il~C~lSPd~k~lat~ssdktv~iwn~ 244 (311)
T KOG0315|consen 203 SELEPVHKFQAHN----GHILRCLLSPDVKYLATCSSDKTVKIWNT 244 (311)
T ss_pred ccceEhhheeccc----ceEEEEEECCCCcEEEeecCCceEEEEec
Confidence 223344443 37999999999999999999999888543
No 17
>KOG0268 consensus Sof1-like rRNA processing protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.92 E-value=3e-25 Score=191.08 Aligned_cols=186 Identities=18% Similarity=0.246 Sum_probs=144.1
Q ss_pred EEEEeCCCCcceEEeecCCCCeEEEEEecCC-CEEEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCC--cEEEE
Q 040274 91 VTMWKPTTSALLIKMLYHQGPVSALAFHPNG-HLMATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG--LLAVG 165 (359)
Q Consensus 91 v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g-~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g--l~~~~ 165 (359)
|.|||.....|+..+......|.++.|+|.. ..|++|+.|+.|.+||++++.+++.+ ....+.|+|+|.+ +++++
T Consensus 169 i~IWD~~R~~Pv~smswG~Dti~svkfNpvETsILas~~sDrsIvLyD~R~~~Pl~KVi~~mRTN~IswnPeafnF~~a~ 248 (433)
T KOG0268|consen 169 IDIWDEQRDNPVSSMSWGADSISSVKFNPVETSILASCASDRSIVLYDLRQASPLKKVILTMRTNTICWNPEAFNFVAAN 248 (433)
T ss_pred eeecccccCCccceeecCCCceeEEecCCCcchheeeeccCCceEEEecccCCccceeeeeccccceecCccccceeecc
Confidence 3444444445666666667788999999954 46788889999999999999998877 5567899999977 88888
Q ss_pred cCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE--------------------------
Q 040274 166 TGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI-------------------------- 219 (359)
Q Consensus 166 ~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i-------------------------- 219 (359)
.|..++.||++....++..+.+|.. .|.++.|||.|+-+++|+.|..|+|
T Consensus 249 ED~nlY~~DmR~l~~p~~v~~dhvs----AV~dVdfsptG~EfvsgsyDksIRIf~~~~~~SRdiYhtkRMq~V~~Vk~S 324 (433)
T KOG0268|consen 249 EDHNLYTYDMRNLSRPLNVHKDHVS----AVMDVDFSPTGQEFVSGSYDKSIRIFPVNHGHSRDIYHTKRMQHVFCVKYS 324 (433)
T ss_pred ccccceehhhhhhcccchhhcccce----eEEEeccCCCcchhccccccceEEEeecCCCcchhhhhHhhhheeeEEEEe
Confidence 9999999999887777777777644 8999999999999999999999988
Q ss_pred -----EEcCCCCCceeeeccCCCCC--hhhhhhHHHHHhhhccCCCeeeeCCCCcccccccccccCCchh
Q 040274 220 -----LVPRSSEPNFDSWVANPFET--SKQRREKEVHSLLDKLLLETIMLNPSKIGTVREAKKKEKPTKQ 282 (359)
Q Consensus 220 -----~~~gs~~~~~~~~~~~~~~~--~~~~~e~ev~~ll~~~~~~~i~~~~~~~~~~~~~~~~~~~~~~ 282 (359)
+++||+|+|+++|.++..+. ....+|.....+.+++... +-+-.+|.+|.++...++.-..
T Consensus 325 ~Dskyi~SGSdd~nvRlWka~Aseklgv~t~rEk~~~~Y~e~Lke~--y~~~peIkRIarHR~lPk~i~~ 392 (433)
T KOG0268|consen 325 MDSKYIISGSDDGNVRLWKAKASEKLGVITPREKNKLEYNEALKER--YKHLPEIKRIARHRHLPKPIKK 392 (433)
T ss_pred ccccEEEecCCCcceeeeecchhhhcCCCChhHHHHHHHHHHHHHH--HhhcHHHHHHHhhccCCHHHHH
Confidence 68999999999999987654 4455565555555555444 2344567778776655544333
No 18
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.92 E-value=1.3e-23 Score=195.88 Aligned_cols=167 Identities=19% Similarity=0.325 Sum_probs=148.7
Q ss_pred eEEEECCCCCEEEEecc------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeec
Q 040274 52 ILWILPSSGRYMAVAGR------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLY 107 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~ 107 (359)
..+.|+..|..||.|+. .++|++++|||++|+||+.||.|+|||..++-|..+|..
T Consensus 311 ~t~~~N~tGDWiA~g~~klgQLlVweWqsEsYVlKQQgH~~~i~~l~YSpDgq~iaTG~eDgKVKvWn~~SgfC~vTFte 390 (893)
T KOG0291|consen 311 LTVSFNSTGDWIAFGCSKLGQLLVWEWQSESYVLKQQGHSDRITSLAYSPDGQLIATGAEDGKVKVWNTQSGFCFVTFTE 390 (893)
T ss_pred eEEEecccCCEEEEcCCccceEEEEEeeccceeeeccccccceeeEEECCCCcEEEeccCCCcEEEEeccCceEEEEecc
Confidence 56677788999999887 899999999999999999999999999999999999999
Q ss_pred CCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec--CC--ceeEEEcCCC-cEE-EEcCC-cEEEEcCCCCCc
Q 040274 108 HQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT--GH--AKTLDFSQKG-LLA-VGTGS-FAQILGDFSGSH 180 (359)
Q Consensus 108 h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~--~~--v~~~~~s~~g-l~~-~~~d~-~i~v~d~~~~~~ 180 (359)
|+..|+++.|+..|+.+++++.||+|+.||+..+...++|. .+ ..|++..|.| +++ ++.|. .|.||++.++ +
T Consensus 391 Hts~Vt~v~f~~~g~~llssSLDGtVRAwDlkRYrNfRTft~P~p~QfscvavD~sGelV~AG~~d~F~IfvWS~qTG-q 469 (893)
T KOG0291|consen 391 HTSGVTAVQFTARGNVLLSSSLDGTVRAWDLKRYRNFRTFTSPEPIQFSCVAVDPSGELVCAGAQDSFEIFVWSVQTG-Q 469 (893)
T ss_pred CCCceEEEEEEecCCEEEEeecCCeEEeeeecccceeeeecCCCceeeeEEEEcCCCCEEEeeccceEEEEEEEeecC-e
Confidence 99999999999999999999999999999999999988883 33 4889999999 544 44453 7999996555 8
Q ss_pred cccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 181 NYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 181 ~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
.+..+.+|.+ +|.+++|+|++..|++|+.|.++++|..-
T Consensus 470 llDiLsGHEg----PVs~l~f~~~~~~LaS~SWDkTVRiW~if 508 (893)
T KOG0291|consen 470 LLDILSGHEG----PVSGLSFSPDGSLLASGSWDKTVRIWDIF 508 (893)
T ss_pred eeehhcCCCC----cceeeEEccccCeEEeccccceEEEEEee
Confidence 8888999876 99999999999999999999999997543
No 19
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.92 E-value=1.3e-23 Score=171.50 Aligned_cols=176 Identities=16% Similarity=0.229 Sum_probs=160.2
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h 108 (359)
..+.|.-||+|.++||. .|..++.+.|+..|++|+.|..|.+||+.||+.+..|.+|
T Consensus 21 ~avryN~dGnY~ltcGsdrtvrLWNp~rg~liktYsghG~EVlD~~~s~Dnskf~s~GgDk~v~vwDV~TGkv~Rr~rgH 100 (307)
T KOG0316|consen 21 RAVRYNVDGNYCLTCGSDRTVRLWNPLRGALIKTYSGHGHEVLDAALSSDNSKFASCGGDKAVQVWDVNTGKVDRRFRGH 100 (307)
T ss_pred EEEEEccCCCEEEEcCCCceEEeecccccceeeeecCCCceeeeccccccccccccCCCCceEEEEEcccCeeeeecccc
Confidence 67889999999999987 7888999999999999999999999999999999999999
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCC--CeeeEee---cCCceeEEEcCCCcEEEEcCCcEEEEcCCCCCcccc
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRK--YEVLQTL---TGHAKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYS 183 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~--~~~~~~~---~~~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~ 183 (359)
.+.|+.+.|+.+...+++|+.|.++++||.++ .++++.+ .+.|.++..+...+++++.||+++.||++.+ ....
T Consensus 101 ~aqVNtV~fNeesSVv~SgsfD~s~r~wDCRS~s~ePiQildea~D~V~Si~v~~heIvaGS~DGtvRtydiR~G-~l~s 179 (307)
T KOG0316|consen 101 LAQVNTVRFNEESSVVASGSFDSSVRLWDCRSRSFEPIQILDEAKDGVSSIDVAEHEIVAGSVDGTVRTYDIRKG-TLSS 179 (307)
T ss_pred cceeeEEEecCcceEEEeccccceeEEEEcccCCCCccchhhhhcCceeEEEecccEEEeeccCCcEEEEEeecc-eeeh
Confidence 99999999999999999999999999999986 4677777 5678999988777999999999999997665 5666
Q ss_pred ccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE--------------------------------EEcCCCCCceee
Q 040274 184 RYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI--------------------------------LVPRSSEPNFDS 231 (359)
Q Consensus 184 ~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i--------------------------------~~~gs~~~~~~~ 231 (359)
-|.+| +|+|++|++++++++.++-|+++++ +++|+.|+.+..
T Consensus 180 Dy~g~------pit~vs~s~d~nc~La~~l~stlrLlDk~tGklL~sYkGhkn~eykldc~l~qsdthV~sgSEDG~Vy~ 253 (307)
T KOG0316|consen 180 DYFGH------PITSVSFSKDGNCSLASSLDSTLRLLDKETGKLLKSYKGHKNMEYKLDCCLNQSDTHVFSGSEDGKVYF 253 (307)
T ss_pred hhcCC------cceeEEecCCCCEEEEeeccceeeecccchhHHHHHhcccccceeeeeeeecccceeEEeccCCceEEE
Confidence 77777 8999999999999999999999887 688999999999
Q ss_pred ecc
Q 040274 232 WVA 234 (359)
Q Consensus 232 ~~~ 234 (359)
|+.
T Consensus 254 wdL 256 (307)
T KOG0316|consen 254 WDL 256 (307)
T ss_pred EEe
Confidence 986
No 20
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=99.92 E-value=4e-24 Score=185.32 Aligned_cols=149 Identities=16% Similarity=0.225 Sum_probs=127.5
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeee-Eee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVL-QTL 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~-~~~ 147 (359)
+|.|++|+|+|..|++|+.|.+|++||+.|..++.+.++|..-|.|++|+|||..||+|+.||.|++||..+|+++ ..+
T Consensus 117 ~Vl~~~fsp~g~~l~tGsGD~TvR~WD~~TeTp~~t~KgH~~WVlcvawsPDgk~iASG~~dg~I~lwdpktg~~~g~~l 196 (480)
T KOG0271|consen 117 AVLSVQFSPTGSRLVTGSGDTTVRLWDLDTETPLFTCKGHKNWVLCVAWSPDGKKIASGSKDGSIRLWDPKTGQQIGRAL 196 (480)
T ss_pred cEEEEEecCCCceEEecCCCceEEeeccCCCCcceeecCCccEEEEEEECCCcchhhccccCCeEEEecCCCCCcccccc
Confidence 8999999999999999999999999999999999999999999999999999999999999999999999988754 344
Q ss_pred c---CCceeEEEcCCC-------cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeE
Q 040274 148 T---GHAKTLDFSQKG-------LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWS 217 (359)
Q Consensus 148 ~---~~v~~~~~s~~g-------l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~ 217 (359)
. .+|++++|.|-. +++++.||+|+|||+ ..+..+..+.+|.. +|+|++|--+ .+|++|+.|++|
T Consensus 197 ~gH~K~It~Lawep~hl~p~~r~las~skDg~vrIWd~-~~~~~~~~lsgHT~----~VTCvrwGG~-gliySgS~DrtI 270 (480)
T KOG0271|consen 197 RGHKKWITALAWEPLHLVPPCRRLASSSKDGSVRIWDT-KLGTCVRTLSGHTA----SVTCVRWGGE-GLIYSGSQDRTI 270 (480)
T ss_pred cCcccceeEEeecccccCCCccceecccCCCCEEEEEc-cCceEEEEeccCcc----ceEEEEEcCC-ceEEecCCCceE
Confidence 4 458999998732 677788999999995 44467777778866 8999999654 477777777766
Q ss_pred EEEEcC
Q 040274 218 GILVPR 223 (359)
Q Consensus 218 ~i~~~g 223 (359)
.+|...
T Consensus 271 kvw~a~ 276 (480)
T KOG0271|consen 271 KVWRAL 276 (480)
T ss_pred EEEEcc
Confidence 666543
No 21
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=99.91 E-value=7.6e-23 Score=194.34 Aligned_cols=173 Identities=22% Similarity=0.328 Sum_probs=150.2
Q ss_pred eEEEECCCCCEEEEecc------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeec
Q 040274 52 ILWILPSSGRYMAVAGR------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLY 107 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~ 107 (359)
++++|+|||+++++++. .|++++|+|+++++++|+.|++|+|||+.+++++..+.+
T Consensus 207 ~~~~fs~d~~~l~s~s~D~tiriwd~~~~~~~~~~l~gH~~~v~~~~f~p~g~~i~Sgs~D~tvriWd~~~~~~~~~l~~ 286 (456)
T KOG0266|consen 207 SDVAFSPDGSYLLSGSDDKTLRIWDLKDDGRNLKTLKGHSTYVTSVAFSPDGNLLVSGSDDGTVRIWDVRTGECVRKLKG 286 (456)
T ss_pred eeeEECCCCcEEEEecCCceEEEeeccCCCeEEEEecCCCCceEEEEecCCCCEEEEecCCCcEEEEeccCCeEEEeeec
Confidence 99999999999999987 899999999999999999999999999999999999999
Q ss_pred CCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCe--eeEee----cC-CceeEEEcCCC--cEEEEcCCcEEEEcCCCC
Q 040274 108 HQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYE--VLQTL----TG-HAKTLDFSQKG--LLAVGTGSFAQILGDFSG 178 (359)
Q Consensus 108 h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~--~~~~~----~~-~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~ 178 (359)
|.+.|++++|+++|++|++++.|+.|++||+.++. ++..+ .. ++++++|+|+| +++++.|+.+.+||+...
T Consensus 287 hs~~is~~~f~~d~~~l~s~s~d~~i~vwd~~~~~~~~~~~~~~~~~~~~~~~~~fsp~~~~ll~~~~d~~~~~w~l~~~ 366 (456)
T KOG0266|consen 287 HSDGISGLAFSPDGNLLVSASYDGTIRVWDLETGSKLCLKLLSGAENSAPVTSVQFSPNGKYLLSASLDRTLKLWDLRSG 366 (456)
T ss_pred cCCceEEEEECCCCCEEEEcCCCccEEEEECCCCceeeeecccCCCCCCceeEEEECCCCcEEEEecCCCeEEEEEccCC
Confidence 99999999999999999999999999999999998 55555 12 57999999999 777778889999996544
Q ss_pred CccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCC
Q 040274 179 SHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSE 226 (359)
Q Consensus 179 ~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~ 226 (359)
.....+..|.. ....+.+..+++.+.++++|+.|+.+.+|...++.
T Consensus 367 -~~~~~~~~~~~-~~~~~~~~~~~~~~~~i~sg~~d~~v~~~~~~s~~ 412 (456)
T KOG0266|consen 367 -KSVGTYTGHSN-LVRCIFSPTLSTGGKLIYSGSEDGSVYVWDSSSGG 412 (456)
T ss_pred -cceeeecccCC-cceeEecccccCCCCeEEEEeCCceEEEEeCCccc
Confidence 56667777743 11245566678899999999999999998887643
No 22
>KOG0265 consensus U5 snRNP-specific protein-like factor and related proteins [RNA processing and modification]
Probab=99.91 E-value=3.4e-23 Score=174.45 Aligned_cols=164 Identities=16% Similarity=0.195 Sum_probs=147.1
Q ss_pred eEEEECCCCCEEEEecc------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeec
Q 040274 52 ILWILPSSGRYMAVAGR------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLY 107 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~ 107 (359)
+.+.|+|+|.+||+||. .|..+.|.+|++.|++++.|.+|+.||..+|+.+..+.+
T Consensus 51 ~~~~F~P~gs~~aSgG~Dr~I~LWnv~gdceN~~~lkgHsgAVM~l~~~~d~s~i~S~gtDk~v~~wD~~tG~~~rk~k~ 130 (338)
T KOG0265|consen 51 YTIKFHPDGSCFASGGSDRAIVLWNVYGDCENFWVLKGHSGAVMELHGMRDGSHILSCGTDKTVRGWDAETGKRIRKHKG 130 (338)
T ss_pred EEEEECCCCCeEeecCCcceEEEEeccccccceeeeccccceeEeeeeccCCCEEEEecCCceEEEEecccceeeehhcc
Confidence 99999999999999997 899999999999999999999999999999999999999
Q ss_pred CCCCeEEEEEecCC-CEEEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccc
Q 040274 108 HQGPVSALAFHPNG-HLMATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNY 182 (359)
Q Consensus 108 h~~~v~~l~~~p~g-~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~ 182 (359)
|.+-|+++.-+.-| .++.+++.|+++++||+|+..+++++ +..++++.|..++ .++++-|+.|.+||++.. ...
T Consensus 131 h~~~vNs~~p~rrg~~lv~SgsdD~t~kl~D~R~k~~~~t~~~kyqltAv~f~d~s~qv~sggIdn~ikvWd~r~~-d~~ 209 (338)
T KOG0265|consen 131 HTSFVNSLDPSRRGPQLVCSGSDDGTLKLWDIRKKEAIKTFENKYQLTAVGFKDTSDQVISGGIDNDIKVWDLRKN-DGL 209 (338)
T ss_pred ccceeeecCccccCCeEEEecCCCceEEEEeecccchhhccccceeEEEEEecccccceeeccccCceeeeccccC-cce
Confidence 99999999854434 45677888999999999999999998 5678999999988 899999999999997665 556
Q ss_pred cccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEE
Q 040274 183 SRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGIL 220 (359)
Q Consensus 183 ~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~ 220 (359)
..+.+|.. +|+.+..+|+|.++++-+.|..+++|
T Consensus 210 ~~lsGh~D----tIt~lsls~~gs~llsnsMd~tvrvw 243 (338)
T KOG0265|consen 210 YTLSGHAD----TITGLSLSRYGSFLLSNSMDNTVRVW 243 (338)
T ss_pred EEeecccC----ceeeEEeccCCCccccccccceEEEE
Confidence 66677755 89999999999999999999988774
No 23
>KOG0283 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.90 E-value=1.2e-22 Score=191.93 Aligned_cols=166 Identities=16% Similarity=0.254 Sum_probs=132.8
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCCCeeeEee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHP-NGHLMATTGKECKIKIWDLRKYEVLQTL 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~~~~~~~~ 147 (359)
.|..|.||.++ +|++++.|.+|+||++....|+..| .|...|+|++|+| |.+||++|+.||.|+||++...+.+.-.
T Consensus 371 DILDlSWSKn~-fLLSSSMDKTVRLWh~~~~~CL~~F-~HndfVTcVaFnPvDDryFiSGSLD~KvRiWsI~d~~Vv~W~ 448 (712)
T KOG0283|consen 371 DILDLSWSKNN-FLLSSSMDKTVRLWHPGRKECLKVF-SHNDFVTCVAFNPVDDRYFISGSLDGKVRLWSISDKKVVDWN 448 (712)
T ss_pred hheecccccCC-eeEeccccccEEeecCCCcceeeEE-ecCCeeEEEEecccCCCcEeecccccceEEeecCcCeeEeeh
Confidence 89999999754 9999999999999999999999888 7999999999999 8899999999999999999987765544
Q ss_pred --cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCcccccccc--c---cCCCCcceeEEEEccCC-CEEEEEeCCCeE
Q 040274 148 --TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMG--N---SMVKGYQIGKVSFRPYE-DVLGIGHSMGWS 217 (359)
Q Consensus 148 --~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~--~---~~~~~~~v~~~~~sp~~-~~l~~g~~dg~~ 217 (359)
..-|++++|+|+| .+.|+.+|.+++|++... .......- + .. .+..|+.+.|.|.. +.+++.+.|..|
T Consensus 449 Dl~~lITAvcy~PdGk~avIGt~~G~C~fY~t~~l-k~~~~~~I~~~~~Kk~-~~~rITG~Q~~p~~~~~vLVTSnDSrI 526 (712)
T KOG0283|consen 449 DLRDLITAVCYSPDGKGAVIGTFNGYCRFYDTEGL-KLVSDFHIRLHNKKKK-QGKRITGLQFFPGDPDEVLVTSNDSRI 526 (712)
T ss_pred hhhhhheeEEeccCCceEEEEEeccEEEEEEccCC-eEEEeeeEeeccCccc-cCceeeeeEecCCCCCeEEEecCCCce
Confidence 5679999999999 788889999999996443 22221111 1 11 12269999998754 457777788877
Q ss_pred EE--------------------------------EEcCCCCCceeeeccCCCC
Q 040274 218 GI--------------------------------LVPRSSEPNFDSWVANPFE 238 (359)
Q Consensus 218 ~i--------------------------------~~~gs~~~~~~~~~~~~~~ 238 (359)
+| ++.++.|..+.+|...++.
T Consensus 527 RI~d~~~~~lv~KfKG~~n~~SQ~~Asfs~Dgk~IVs~seDs~VYiW~~~~~~ 579 (712)
T KOG0283|consen 527 RIYDGRDKDLVHKFKGFRNTSSQISASFSSDGKHIVSASEDSWVYIWKNDSFN 579 (712)
T ss_pred EEEeccchhhhhhhcccccCCcceeeeEccCCCEEEEeecCceEEEEeCCCCc
Confidence 77 6777888889999875443
No 24
>KOG0318 consensus WD40 repeat stress protein/actin interacting protein [Cytoskeleton]
Probab=99.90 E-value=7.2e-22 Score=177.61 Aligned_cols=154 Identities=17% Similarity=0.232 Sum_probs=137.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee---cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeE
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML---YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQ 145 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~---~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~ 145 (359)
-|+|+.|+|||..|++++.||.|.+||-.+++.+..+. +|.+.|++++|+||+..|+|++.|.+++|||+.+.+++.
T Consensus 192 FV~~VRysPDG~~Fat~gsDgki~iyDGktge~vg~l~~~~aHkGsIfalsWsPDs~~~~T~SaDkt~KIWdVs~~slv~ 271 (603)
T KOG0318|consen 192 FVNCVRYSPDGSRFATAGSDGKIYIYDGKTGEKVGELEDSDAHKGSIFALSWSPDSTQFLTVSADKTIKIWDVSTNSLVS 271 (603)
T ss_pred ceeeEEECCCCCeEEEecCCccEEEEcCCCccEEEEecCCCCccccEEEEEECCCCceEEEecCCceEEEEEeeccceEE
Confidence 79999999999999999999999999999999999888 899999999999999999999999999999999999999
Q ss_pred eec------CCceeEEEcCCCcEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 146 TLT------GHAKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 146 ~~~------~~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
++. .....+-|-.+.+++++.+|+|.+++.... .....+.+|.. .|+++..+|++.+|++|+.||.+.-
T Consensus 272 t~~~~~~v~dqqvG~lWqkd~lItVSl~G~in~ln~~d~-~~~~~i~GHnK----~ITaLtv~~d~~~i~SgsyDG~I~~ 346 (603)
T KOG0318|consen 272 TWPMGSTVEDQQVGCLWQKDHLITVSLSGTINYLNPSDP-SVLKVISGHNK----SITALTVSPDGKTIYSGSYDGHINS 346 (603)
T ss_pred EeecCCchhceEEEEEEeCCeEEEEEcCcEEEEecccCC-Chhheeccccc----ceeEEEEcCCCCEEEeeccCceEEE
Confidence 883 223556676555999999999999996555 47777778755 8999999999999999999999999
Q ss_pred EEcCCCCC
Q 040274 220 LVPRSSEP 227 (359)
Q Consensus 220 ~~~gs~~~ 227 (359)
|..+++..
T Consensus 347 W~~~~g~~ 354 (603)
T KOG0318|consen 347 WDSGSGTS 354 (603)
T ss_pred EecCCccc
Confidence 98887743
No 25
>PTZ00421 coronin; Provisional
Probab=99.90 E-value=1.8e-21 Score=184.81 Aligned_cols=171 Identities=15% Similarity=0.225 Sum_probs=140.4
Q ss_pred eEEEECC-CCCEEEEecc------------------------------ceeEEEEcCCC-CEEEEEeCCCeEEEEeCCCC
Q 040274 52 ILWILPS-SGRYMAVAGR------------------------------RTDLMRVNPFN-GVVSLGHSGGTVTMWKPTTS 99 (359)
Q Consensus 52 ~~l~~sp-dg~~l~~~~~------------------------------~v~~l~~sp~~-~~l~tg~~dg~v~lwd~~~~ 99 (359)
++++|+| ++++|++|+. .|.+++|+|++ .+|++|+.|++|+|||+.++
T Consensus 79 ~~v~fsP~d~~~LaSgS~DgtIkIWdi~~~~~~~~~~~~l~~L~gH~~~V~~l~f~P~~~~iLaSgs~DgtVrIWDl~tg 158 (493)
T PTZ00421 79 IDVAFNPFDPQKLFTASEDGTIMGWGIPEEGLTQNISDPIVHLQGHTKKVGIVSFHPSAMNVLASAGADMVVNVWDVERG 158 (493)
T ss_pred EEEEEcCCCCCEEEEEeCCCEEEEEecCCCccccccCcceEEecCCCCcEEEEEeCcCCCCEEEEEeCCCEEEEEECCCC
Confidence 8999999 8999999876 57889999975 69999999999999999999
Q ss_pred cceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecCC----ceeEEEcCCC--cEEEE----cCCc
Q 040274 100 ALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTGH----AKTLDFSQKG--LLAVG----TGSF 169 (359)
Q Consensus 100 ~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~~----v~~~~~s~~g--l~~~~----~d~~ 169 (359)
..+..+.+|...|++++|+|+|.+|++++.|+.|++||+++++.+.++.++ +..+.|++++ +++++ .|+.
T Consensus 159 ~~~~~l~~h~~~V~sla~spdG~lLatgs~Dg~IrIwD~rsg~~v~tl~~H~~~~~~~~~w~~~~~~ivt~G~s~s~Dr~ 238 (493)
T PTZ00421 159 KAVEVIKCHSDQITSLEWNLDGSLLCTTSKDKKLNIIDPRDGTIVSSVEAHASAKSQRCLWAKRKDLIITLGCSKSQQRQ 238 (493)
T ss_pred eEEEEEcCCCCceEEEEEECCCCEEEEecCCCEEEEEECCCCcEEEEEecCCCCcceEEEEcCCCCeEEEEecCCCCCCe
Confidence 999899999999999999999999999999999999999999988877443 3467888886 66555 3689
Q ss_pred EEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEe-CCCeEEEEEcCCC
Q 040274 170 AQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGH-SMGWSGILVPRSS 225 (359)
Q Consensus 170 i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~-~dg~~~i~~~gs~ 225 (359)
|.+||++...........+ ....+....|++++.+|++|+ .||.+++|....+
T Consensus 239 VklWDlr~~~~p~~~~~~d---~~~~~~~~~~d~d~~~L~lggkgDg~Iriwdl~~~ 292 (493)
T PTZ00421 239 IMLWDTRKMASPYSTVDLD---QSSALFIPFFDEDTNLLYIGSKGEGNIRCFELMNE 292 (493)
T ss_pred EEEEeCCCCCCceeEeccC---CCCceEEEEEcCCCCEEEEEEeCCCeEEEEEeeCC
Confidence 9999986654333332222 223466778999999999887 5999999866544
No 26
>KOG0275 consensus Conserved WD40 repeat-containing protein [General function prediction only]
Probab=99.89 E-value=5.7e-23 Score=174.84 Aligned_cols=180 Identities=12% Similarity=0.195 Sum_probs=147.3
Q ss_pred eEEEECCCCCEEEEecc-------------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCc
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSA 100 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~ 100 (359)
-|..|||||+||++|+- +|.|++||.|..++++|+.||.|.+|.+.+|.
T Consensus 217 EcA~FSPDgqyLvsgSvDGFiEVWny~~GKlrKDLkYQAqd~fMMmd~aVlci~FSRDsEMlAsGsqDGkIKvWri~tG~ 296 (508)
T KOG0275|consen 217 ECARFSPDGQYLVSGSVDGFIEVWNYTTGKLRKDLKYQAQDNFMMMDDAVLCISFSRDSEMLASGSQDGKIKVWRIETGQ 296 (508)
T ss_pred hheeeCCCCceEeeccccceeeeehhccchhhhhhhhhhhcceeecccceEEEeecccHHHhhccCcCCcEEEEEEecch
Confidence 68889999999999986 89999999999999999999999999999999
Q ss_pred ceEEee-cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecCC---ceeEEEcCCC--cEEEEcCCcEEEEc
Q 040274 101 LLIKML-YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTGH---AKTLDFSQKG--LLAVGTGSFAQILG 174 (359)
Q Consensus 101 ~~~~~~-~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~~---v~~~~~s~~g--l~~~~~d~~i~v~d 174 (359)
|+..|. +|+..|+|+.|+.|+..+++++.|.++++.-+.+|+++..+.+| |+...|+++| +++++.||+|.||+
T Consensus 297 ClRrFdrAHtkGvt~l~FSrD~SqiLS~sfD~tvRiHGlKSGK~LKEfrGHsSyvn~a~ft~dG~~iisaSsDgtvkvW~ 376 (508)
T KOG0275|consen 297 CLRRFDRAHTKGVTCLSFSRDNSQILSASFDQTVRIHGLKSGKCLKEFRGHSSYVNEATFTDDGHHIISASSDGTVKVWH 376 (508)
T ss_pred HHHHhhhhhccCeeEEEEccCcchhhcccccceEEEeccccchhHHHhcCccccccceEEcCCCCeEEEecCCccEEEec
Confidence 999998 89999999999999999999999999999999999999999665 7889999999 99999999999999
Q ss_pred CCCCCc-------------------------------------------cccccccccCCCCcceeEEEEccCCCEEEEE
Q 040274 175 DFSGSH-------------------------------------------NYSRYMGNSMVKGYQIGKVSFRPYEDVLGIG 211 (359)
Q Consensus 175 ~~~~~~-------------------------------------------~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g 211 (359)
..++.. .+..+.... ..++...++..+|.|.|+++.
T Consensus 377 ~KtteC~~Tfk~~~~d~~vnsv~~~PKnpeh~iVCNrsntv~imn~qGQvVrsfsSGk-REgGdFi~~~lSpkGewiYci 455 (508)
T KOG0275|consen 377 GKTTECLSTFKPLGTDYPVNSVILLPKNPEHFIVCNRSNTVYIMNMQGQVVRSFSSGK-REGGDFINAILSPKGEWIYCI 455 (508)
T ss_pred CcchhhhhhccCCCCcccceeEEEcCCCCceEEEEcCCCeEEEEeccceEEeeeccCC-ccCCceEEEEecCCCcEEEEE
Confidence 654310 000111100 123344556788999999999
Q ss_pred eCCCeEEEEEc--CCCCCceeee
Q 040274 212 HSMGWSGILVP--RSSEPNFDSW 232 (359)
Q Consensus 212 ~~dg~~~i~~~--gs~~~~~~~~ 232 (359)
+.|+.+..|.. |.-+.++.+-
T Consensus 456 gED~vlYCF~~~sG~LE~tl~Vh 478 (508)
T KOG0275|consen 456 GEDGVLYCFSVLSGKLERTLPVH 478 (508)
T ss_pred ccCcEEEEEEeecCceeeeeecc
Confidence 99998766543 3334444443
No 27
>KOG0295 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.89 E-value=6.3e-22 Score=170.75 Aligned_cols=176 Identities=13% Similarity=0.169 Sum_probs=152.3
Q ss_pred eEEEECCCCCEEEEecc------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeec
Q 040274 52 ILWILPSSGRYMAVAGR------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLY 107 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~ 107 (359)
+++.|+..|++|++++. .|.++.|-|.|.+|++++.|.+|.+|++.++-++.+|.+
T Consensus 154 ~di~~~a~Gk~l~tcSsDl~~~LWd~~~~~~c~ks~~gh~h~vS~V~f~P~gd~ilS~srD~tik~We~~tg~cv~t~~~ 233 (406)
T KOG0295|consen 154 FDISFDASGKYLATCSSDLSAKLWDFDTFFRCIKSLIGHEHGVSSVFFLPLGDHILSCSRDNTIKAWECDTGYCVKTFPG 233 (406)
T ss_pred eEEEEecCccEEEecCCccchhheeHHHHHHHHHHhcCcccceeeEEEEecCCeeeecccccceeEEecccceeEEeccC
Confidence 99999999999999987 899999999999999999999999999999999999999
Q ss_pred CCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee---cCCceeEEEcC--------------CC---cEEEEcC
Q 040274 108 HQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL---TGHAKTLDFSQ--------------KG---LLAVGTG 167 (359)
Q Consensus 108 h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~---~~~v~~~~~s~--------------~g---l~~~~~d 167 (359)
|..-|..+..+.||.++++++.|.+|++|-+.++++...+ .-+|-+++|-| +| +.+++.|
T Consensus 234 h~ewvr~v~v~~DGti~As~s~dqtl~vW~~~t~~~k~~lR~hEh~vEci~wap~~~~~~i~~at~~~~~~~~l~s~SrD 313 (406)
T KOG0295|consen 234 HSEWVRMVRVNQDGTIIASCSNDQTLRVWVVATKQCKAELREHEHPVECIAWAPESSYPSISEATGSTNGGQVLGSGSRD 313 (406)
T ss_pred chHhEEEEEecCCeeEEEecCCCceEEEEEeccchhhhhhhccccceEEEEecccccCcchhhccCCCCCccEEEeeccc
Confidence 9999999999999999999999999999999998665555 44577888855 22 6677889
Q ss_pred CcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCCCceeeec
Q 040274 168 SFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSEPNFDSWV 233 (359)
Q Consensus 168 ~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~~~~~~~~ 233 (359)
++|++||+.++ ..+.++.+|.. .|..++|+|.|+||+++.+|+.+++|.-.... ....|+
T Consensus 314 ktIk~wdv~tg-~cL~tL~ghdn----wVr~~af~p~Gkyi~ScaDDktlrvwdl~~~~-cmk~~~ 373 (406)
T KOG0295|consen 314 KTIKIWDVSTG-MCLFTLVGHDN----WVRGVAFSPGGKYILSCADDKTLRVWDLKNLQ-CMKTLE 373 (406)
T ss_pred ceEEEEeccCC-eEEEEEecccc----eeeeeEEcCCCeEEEEEecCCcEEEEEeccce-eeeccC
Confidence 99999997665 66777777754 89999999999999999999999988655443 234444
No 28
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.89 E-value=9.9e-22 Score=175.35 Aligned_cols=178 Identities=17% Similarity=0.244 Sum_probs=153.5
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCCcceEEeec
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTSALLIKMLY 107 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~ 107 (359)
++++|-.||++|++|.. +|+.+.|+| ++..+++|+.|+.+.+||+.+......+.+
T Consensus 72 ~s~~fR~DG~LlaaGD~sG~V~vfD~k~r~iLR~~~ah~apv~~~~f~~~d~t~l~s~sDd~v~k~~d~s~a~v~~~l~~ 151 (487)
T KOG0310|consen 72 YSVDFRSDGRLLAAGDESGHVKVFDMKSRVILRQLYAHQAPVHVTKFSPQDNTMLVSGSDDKVVKYWDLSTAYVQAELSG 151 (487)
T ss_pred eEEEeecCCeEEEccCCcCcEEEeccccHHHHHHHhhccCceeEEEecccCCeEEEecCCCceEEEEEcCCcEEEEEecC
Confidence 89999999999999876 899999999 667899999999999999999887668889
Q ss_pred CCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCCC-eeeEee--cCCceeEEEcCCC-cEEEEcCCcEEEEcCCCCCccc
Q 040274 108 HQGPVSALAFHP-NGHLMATTGKECKIKIWDLRKY-EVLQTL--TGHAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNY 182 (359)
Q Consensus 108 h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~~-~~~~~~--~~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~ 182 (359)
|++.|.|.+|+| ++.+++|||.||.|++||+++. ..+.++ ..+|.++.+-|.| +++.+.++.|+|||+..++..+
T Consensus 152 htDYVR~g~~~~~~~hivvtGsYDg~vrl~DtR~~~~~v~elnhg~pVe~vl~lpsgs~iasAgGn~vkVWDl~~G~qll 231 (487)
T KOG0310|consen 152 HTDYVRCGDISPANDHIVVTGSYDGKVRLWDTRSLTSRVVELNHGCPVESVLALPSGSLIASAGGNSVKVWDLTTGGQLL 231 (487)
T ss_pred CcceeEeeccccCCCeEEEecCCCceEEEEEeccCCceeEEecCCCceeeEEEcCCCCEEEEcCCCeEEEEEecCCceeh
Confidence 999999999999 5668999999999999999986 667777 4578999999998 8888888999999988777777
Q ss_pred cccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCCCceeeecc
Q 040274 183 SRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSEPNFDSWVA 234 (359)
Q Consensus 183 ~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~~~~~~~~~ 234 (359)
.....|.- .|+|+++..++..|++|+-|+.+.+|..+ .-..+..|..
T Consensus 232 ~~~~~H~K----tVTcL~l~s~~~rLlS~sLD~~VKVfd~t-~~Kvv~s~~~ 278 (487)
T KOG0310|consen 232 TSMFNHNK----TVTCLRLASDSTRLLSGSLDRHVKVFDTT-NYKVVHSWKY 278 (487)
T ss_pred hhhhcccc----eEEEEEeecCCceEeecccccceEEEEcc-ceEEEEeeec
Confidence 66666644 79999999999999999999999999843 3334555654
No 29
>KOG0273 consensus Beta-transducin family (WD-40 repeat) protein [Chromatin structure and dynamics]
Probab=99.89 E-value=8.5e-22 Score=175.02 Aligned_cols=147 Identities=20% Similarity=0.359 Sum_probs=131.2
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCC---------CEEEEecCCCeEEEEEcC
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNG---------HLMATTGKECKIKIWDLR 139 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g---------~~l~s~~~d~~i~vwd~~ 139 (359)
.|++|.|+|.|.+|+++|.|++++||+.....+...|.+|...|+.+.|+|+| ..+++++.|++|++||+.
T Consensus 361 ~V~alk~n~tg~LLaS~SdD~TlkiWs~~~~~~~~~l~~Hskei~t~~wsp~g~v~~n~~~~~~l~sas~dstV~lwdv~ 440 (524)
T KOG0273|consen 361 EVNALKWNPTGSLLASCSDDGTLKIWSMGQSNSVHDLQAHSKEIYTIKWSPTGPVTSNPNMNLMLASASFDSTVKLWDVE 440 (524)
T ss_pred ceEEEEECCCCceEEEecCCCeeEeeecCCCcchhhhhhhccceeeEeecCCCCccCCCcCCceEEEeecCCeEEEEEcc
Confidence 89999999999999999999999999999888999999999999999999954 479999999999999999
Q ss_pred CCeeeEee---cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 140 KYEVLQTL---TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 140 ~~~~~~~~---~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
.+.++++| ..+|++++|||+| +++++.|+.|.+|++... ..+..+.+.. .|..++|+.+|+.|..+..|
T Consensus 441 ~gv~i~~f~kH~~pVysvafS~~g~ylAsGs~dg~V~iws~~~~-~l~~s~~~~~-----~Ifel~Wn~~G~kl~~~~sd 514 (524)
T KOG0273|consen 441 SGVPIHTLMKHQEPVYSVAFSPNGRYLASGSLDGCVHIWSTKTG-KLVKSYQGTG-----GIFELCWNAAGDKLGACASD 514 (524)
T ss_pred CCceeEeeccCCCceEEEEecCCCcEEEecCCCCeeEeccccch-heeEeecCCC-----eEEEEEEcCCCCEEEEEecC
Confidence 99999999 4569999999999 777888999999996544 6666665543 59999999999999999999
Q ss_pred CeEEEEE
Q 040274 215 GWSGILV 221 (359)
Q Consensus 215 g~~~i~~ 221 (359)
|.+.++.
T Consensus 515 ~~vcvld 521 (524)
T KOG0273|consen 515 GSVCVLD 521 (524)
T ss_pred CCceEEE
Confidence 9887764
No 30
>KOG0645 consensus WD40 repeat protein [General function prediction only]
Probab=99.89 E-value=3e-21 Score=160.66 Aligned_cols=162 Identities=17% Similarity=0.237 Sum_probs=137.7
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCC---cceE
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTS---ALLI 103 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~---~~~~ 103 (359)
.+++|+|.|++|++++. .|-|++||++|.+||+++.|.+|-||.+..+ .++.
T Consensus 65 RsvAwsp~g~~La~aSFD~t~~Iw~k~~~efecv~~lEGHEnEVK~Vaws~sG~~LATCSRDKSVWiWe~deddEfec~a 144 (312)
T KOG0645|consen 65 RSVAWSPHGRYLASASFDATVVIWKKEDGEFECVATLEGHENEVKCVAWSASGNYLATCSRDKSVWIWEIDEDDEFECIA 144 (312)
T ss_pred eeeeecCCCcEEEEeeccceEEEeecCCCceeEEeeeeccccceeEEEEcCCCCEEEEeeCCCeEEEEEecCCCcEEEEe
Confidence 78999999999999987 8999999999999999999999999998744 5778
Q ss_pred EeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcC---CCeeeEeecC---CceeEEEcCCC--cEEEEcCCcEEEEcC
Q 040274 104 KMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLR---KYEVLQTLTG---HAKTLDFSQKG--LLAVGTGSFAQILGD 175 (359)
Q Consensus 104 ~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~---~~~~~~~~~~---~v~~~~~s~~g--l~~~~~d~~i~v~d~ 175 (359)
.+..|+..|-.+.|+|...+|++++.|.+|++|+-. ...+++++.+ .|.+++|++.| |++++.|+++.||-.
T Consensus 145 VL~~HtqDVK~V~WHPt~dlL~S~SYDnTIk~~~~~~dddW~c~~tl~g~~~TVW~~~F~~~G~rl~s~sdD~tv~Iw~~ 224 (312)
T KOG0645|consen 145 VLQEHTQDVKHVIWHPTEDLLFSCSYDNTIKVYRDEDDDDWECVQTLDGHENTVWSLAFDNIGSRLVSCSDDGTVSIWRL 224 (312)
T ss_pred eeccccccccEEEEcCCcceeEEeccCCeEEEEeecCCCCeeEEEEecCccceEEEEEecCCCceEEEecCCcceEeeee
Confidence 899999999999999999999999999999999765 3467888854 58999999999 899999999999974
Q ss_pred CCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCC
Q 040274 176 FSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRS 224 (359)
Q Consensus 176 ~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs 224 (359)
... .-.. +...++.+.|. ...|++++.|+.++++....
T Consensus 225 ~~~-----~~~~----~sr~~Y~v~W~--~~~IaS~ggD~~i~lf~~s~ 262 (312)
T KOG0645|consen 225 YTD-----LSGM----HSRALYDVPWD--NGVIASGGGDDAIRLFKESD 262 (312)
T ss_pred ccC-----cchh----cccceEeeeec--ccceEeccCCCEEEEEEecC
Confidence 321 1112 33478889998 56789999999888887653
No 31
>KOG0285 consensus Pleiotropic regulator 1 [RNA processing and modification]
Probab=99.89 E-value=3.8e-22 Score=171.78 Aligned_cols=155 Identities=19% Similarity=0.272 Sum_probs=141.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
.|.|+++.|.+.+|++|+.|++|.|||+.+++...++.+|...|..+++|+-..||++++.|+.|+.||+...+.++.+-
T Consensus 153 WVr~vavdP~n~wf~tgs~DrtikIwDlatg~LkltltGhi~~vr~vavS~rHpYlFs~gedk~VKCwDLe~nkvIR~Yh 232 (460)
T KOG0285|consen 153 WVRSVAVDPGNEWFATGSADRTIKIWDLATGQLKLTLTGHIETVRGVAVSKRHPYLFSAGEDKQVKCWDLEYNKVIRHYH 232 (460)
T ss_pred eEEEEeeCCCceeEEecCCCceeEEEEcccCeEEEeecchhheeeeeeecccCceEEEecCCCeeEEEechhhhhHHHhc
Confidence 89999999999999999999999999999999999999999999999999999999999999999999999999999886
Q ss_pred CC---ceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 149 GH---AKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 149 ~~---v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
|| |.|++.+|.- +++++.|.+++|||+++. ..+..+.+|.. +|.++.+.|....+++|+.|+++++|.-.
T Consensus 233 GHlS~V~~L~lhPTldvl~t~grDst~RvWDiRtr-~~V~~l~GH~~----~V~~V~~~~~dpqvit~S~D~tvrlWDl~ 307 (460)
T KOG0285|consen 233 GHLSGVYCLDLHPTLDVLVTGGRDSTIRVWDIRTR-ASVHVLSGHTN----PVASVMCQPTDPQVITGSHDSTVRLWDLR 307 (460)
T ss_pred cccceeEEEeccccceeEEecCCcceEEEeeeccc-ceEEEecCCCC----cceeEEeecCCCceEEecCCceEEEeeec
Confidence 65 7899999987 899999999999998765 66777888866 89999999999999999999999998655
Q ss_pred CCCCc
Q 040274 224 SSEPN 228 (359)
Q Consensus 224 s~~~~ 228 (359)
.+...
T Consensus 308 agkt~ 312 (460)
T KOG0285|consen 308 AGKTM 312 (460)
T ss_pred cCcee
Confidence 55433
No 32
>KOG0277 consensus Peroxisomal targeting signal type 2 receptor [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.88 E-value=7.7e-22 Score=162.80 Aligned_cols=177 Identities=15% Similarity=0.219 Sum_probs=148.8
Q ss_pred eEEEECCCCCEEE--Eecc-----------------------ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCCcceEEe
Q 040274 52 ILWILPSSGRYMA--VAGR-----------------------RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTSALLIKM 105 (359)
Q Consensus 52 ~~l~~spdg~~l~--~~~~-----------------------~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~~~~~~ 105 (359)
|+++|+++....+ .+|+ .|.++.|++ .+..++++|.||+|++|++..+..+.+|
T Consensus 64 fdV~Wse~~e~~~~~a~GDGSLrl~d~~~~s~Pi~~~kEH~~EV~Svdwn~~~r~~~ltsSWD~TiKLW~~~r~~Sv~Tf 143 (311)
T KOG0277|consen 64 FDVAWSENHENQVIAASGDGSLRLFDLTMPSKPIHKFKEHKREVYSVDWNTVRRRIFLTSSWDGTIKLWDPNRPNSVQTF 143 (311)
T ss_pred eEeeecCCCcceEEEEecCceEEEeccCCCCcchhHHHhhhhheEEeccccccceeEEeeccCCceEeecCCCCcceEee
Confidence 9999998655433 3333 899999999 6677889999999999999999999999
Q ss_pred ecCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCC-CeeeEee---cCCceeEEEcCCC---cEEEEcCCcEEEEcCCC
Q 040274 106 LYHQGPVSALAFHP-NGHLMATTGKECKIKIWDLRK-YEVLQTL---TGHAKTLDFSQKG---LLAVGTGSFAQILGDFS 177 (359)
Q Consensus 106 ~~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~-~~~~~~~---~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~ 177 (359)
.+|...|....|+| .+++|++++.|+++++||++. |+.+. + ...+.|+.|+.-. +++++.|+.|++||++.
T Consensus 144 ~gh~~~Iy~a~~sp~~~nlfas~Sgd~~l~lwdvr~~gk~~~-i~ah~~Eil~cdw~ky~~~vl~Tg~vd~~vr~wDir~ 222 (311)
T KOG0277|consen 144 NGHNSCIYQAAFSPHIPNLFASASGDGTLRLWDVRSPGKFMS-IEAHNSEILCCDWSKYNHNVLATGGVDNLVRGWDIRN 222 (311)
T ss_pred cCCccEEEEEecCCCCCCeEEEccCCceEEEEEecCCCceeE-EEeccceeEeecccccCCcEEEecCCCceEEEEehhh
Confidence 99999999999999 688999999999999999986 44433 5 3458999998865 77888999999999988
Q ss_pred CCccccccccccCCCCcceeEEEEccCC-CEEEEEeCCCeEEEEEcCCCCCceeeec
Q 040274 178 GSHNYSRYMGNSMVKGYQIGKVSFRPYE-DVLGIGHSMGWSGILVPRSSEPNFDSWV 233 (359)
Q Consensus 178 ~~~~~~~~~~~~~~~~~~v~~~~~sp~~-~~l~~g~~dg~~~i~~~gs~~~~~~~~~ 233 (359)
-..++..+.+|.. .|..+.|||.. .+|++++.|-+++||.+...+..+..++
T Consensus 223 ~r~pl~eL~gh~~----AVRkvk~Sph~~~lLaSasYDmT~riw~~~~~ds~~e~~~ 275 (311)
T KOG0277|consen 223 LRTPLFELNGHGL----AVRKVKFSPHHASLLASASYDMTVRIWDPERQDSAIETVD 275 (311)
T ss_pred ccccceeecCCce----EEEEEecCcchhhHhhhccccceEEecccccchhhhhhhh
Confidence 7777777767655 89999999965 7899999999999998887777666554
No 33
>PLN00181 protein SPA1-RELATED; Provisional
Probab=99.88 E-value=7.4e-21 Score=193.21 Aligned_cols=167 Identities=16% Similarity=0.216 Sum_probs=142.3
Q ss_pred eEEEECCCCCEEEEecc------------------------------ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCCc
Q 040274 52 ILWILPSSGRYMAVAGR------------------------------RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTSA 100 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------------~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~ 100 (359)
.+++|+|+|++|++|+. .+.+++|+| ++.+|++|+.||+|++||+.+++
T Consensus 487 ~~i~fs~dg~~latgg~D~~I~iwd~~~~~~~~~~~~~~~~~~~~~~~v~~l~~~~~~~~~las~~~Dg~v~lWd~~~~~ 566 (793)
T PLN00181 487 CAIGFDRDGEFFATAGVNKKIKIFECESIIKDGRDIHYPVVELASRSKLSGICWNSYIKSQVASSNFEGVVQVWDVARSQ 566 (793)
T ss_pred EEEEECCCCCEEEEEeCCCEEEEEECCcccccccccccceEEecccCceeeEEeccCCCCEEEEEeCCCeEEEEECCCCe
Confidence 88999999999999886 246788887 57899999999999999999999
Q ss_pred ceEEeecCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcC-CC--cEEEEcCCcEEEEc
Q 040274 101 LLIKMLYHQGPVSALAFHP-NGHLMATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQ-KG--LLAVGTGSFAQILG 174 (359)
Q Consensus 101 ~~~~~~~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~-~g--l~~~~~d~~i~v~d 174 (359)
.+..+.+|.+.|++++|+| ++.+|++|+.|++|++||++++.++..+ ...+.++.|++ +| +++++.|+.|++||
T Consensus 567 ~~~~~~~H~~~V~~l~~~p~~~~~L~Sgs~Dg~v~iWd~~~~~~~~~~~~~~~v~~v~~~~~~g~~latgs~dg~I~iwD 646 (793)
T PLN00181 567 LVTEMKEHEKRVWSIDYSSADPTLLASGSDDGSVKLWSINQGVSIGTIKTKANICCVQFPSESGRSLAFGSADHKVYYYD 646 (793)
T ss_pred EEEEecCCCCCEEEEEEcCCCCCEEEEEcCCCEEEEEECCCCcEEEEEecCCCeEEEEEeCCCCCEEEEEeCCCeEEEEE
Confidence 9999999999999999997 7899999999999999999998888777 34678999954 56 78888999999999
Q ss_pred CCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 175 DFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
+.........+.+|.. .|+++.|. ++.+|++++.|+.+.+|...
T Consensus 647 ~~~~~~~~~~~~~h~~----~V~~v~f~-~~~~lvs~s~D~~ikiWd~~ 690 (793)
T PLN00181 647 LRNPKLPLCTMIGHSK----TVSYVRFV-DSSTLVSSSTDNTLKLWDLS 690 (793)
T ss_pred CCCCCccceEecCCCC----CEEEEEEe-CCCEEEEEECCCEEEEEeCC
Confidence 7655334444555543 79999997 78899999999999998754
No 34
>PTZ00421 coronin; Provisional
Probab=99.88 E-value=1.2e-20 Score=179.35 Aligned_cols=147 Identities=14% Similarity=0.259 Sum_probs=120.3
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCC-------cceEEeecCCCCeEEEEEecCC-CEEEEecCCCeEEEEEcC
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTS-------ALLIKMLYHQGPVSALAFHPNG-HLMATTGKECKIKIWDLR 139 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~-------~~~~~~~~h~~~v~~l~~~p~g-~~l~s~~~d~~i~vwd~~ 139 (359)
.|++++|+| ++.+|++|+.||+|++||+.++ .++..+.+|...|.+++|+|++ ++|++++.|++|+|||+.
T Consensus 77 ~V~~v~fsP~d~~~LaSgS~DgtIkIWdi~~~~~~~~~~~~l~~L~gH~~~V~~l~f~P~~~~iLaSgs~DgtVrIWDl~ 156 (493)
T PTZ00421 77 PIIDVAFNPFDPQKLFTASEDGTIMGWGIPEEGLTQNISDPIVHLQGHTKKVGIVSFHPSAMNVLASAGADMVVNVWDVE 156 (493)
T ss_pred CEEEEEEcCCCCCEEEEEeCCCEEEEEecCCCccccccCcceEEecCCCCcEEEEEeCcCCCCEEEEEeCCCEEEEEECC
Confidence 799999999 8889999999999999998764 3567888999999999999975 689999999999999999
Q ss_pred CCeeeEeec---CCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEe--
Q 040274 140 KYEVLQTLT---GHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGH-- 212 (359)
Q Consensus 140 ~~~~~~~~~---~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~-- 212 (359)
+++.+..+. ..|.+++|+|+| +++++.|+.|+|||++.+ .....+..|. +..+..+.|++++..|++++
T Consensus 157 tg~~~~~l~~h~~~V~sla~spdG~lLatgs~Dg~IrIwD~rsg-~~v~tl~~H~---~~~~~~~~w~~~~~~ivt~G~s 232 (493)
T PTZ00421 157 RGKAVEVIKCHSDQITSLEWNLDGSLLCTTSKDKKLNIIDPRDG-TIVSSVEAHA---SAKSQRCLWAKRKDLIITLGCS 232 (493)
T ss_pred CCeEEEEEcCCCCceEEEEEECCCCEEEEecCCCEEEEEECCCC-cEEEEEecCC---CCcceEEEEcCCCCeEEEEecC
Confidence 998887774 458999999999 778888999999997665 4455555553 22355778999887777654
Q ss_pred --CCCeEEE
Q 040274 213 --SMGWSGI 219 (359)
Q Consensus 213 --~dg~~~i 219 (359)
.|+.+.+
T Consensus 233 ~s~Dr~Vkl 241 (493)
T PTZ00421 233 KSQQRQIML 241 (493)
T ss_pred CCCCCeEEE
Confidence 2455554
No 35
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=99.87 E-value=6.4e-21 Score=156.99 Aligned_cols=177 Identities=13% Similarity=0.194 Sum_probs=146.4
Q ss_pred eEEEECCCCCEEEEecc----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee-cC
Q 040274 52 ILWILPSSGRYMAVAGR----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML-YH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~-~h 108 (359)
.++.|..||+.+.+|+. +|+++..+|+..-|++|..+|.|++||+....+...+. ..
T Consensus 87 taVgF~~dgrWMyTgseDgt~kIWdlR~~~~qR~~~~~spVn~vvlhpnQteLis~dqsg~irvWDl~~~~c~~~liPe~ 166 (311)
T KOG0315|consen 87 TAVGFQCDGRWMYTGSEDGTVKIWDLRSLSCQRNYQHNSPVNTVVLHPNQTELISGDQSGNIRVWDLGENSCTHELIPED 166 (311)
T ss_pred EEEEEeecCeEEEecCCCceEEEEeccCcccchhccCCCCcceEEecCCcceEEeecCCCcEEEEEccCCccccccCCCC
Confidence 88999999999999998 89999999998899999999999999999876655544 34
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCC------eeeEee---cCCceeEEEcCCC--cEEEEcCCcEEEEcCCC
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKY------EVLQTL---TGHAKTLDFSQKG--LLAVGTGSFAQILGDFS 177 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~------~~~~~~---~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~ 177 (359)
..+|.++++.|||.+|+.+...|++++|++-.. .++..+ .+++..+.+||++ ++++|.|.+++||++..
T Consensus 167 ~~~i~sl~v~~dgsml~a~nnkG~cyvW~l~~~~~~s~l~P~~k~~ah~~~il~C~lSPd~k~lat~ssdktv~iwn~~~ 246 (311)
T KOG0315|consen 167 DTSIQSLTVMPDGSMLAAANNKGNCYVWRLLNHQTASELEPVHKFQAHNGHILRCLLSPDVKYLATCSSDKTVKIWNTDD 246 (311)
T ss_pred CcceeeEEEcCCCcEEEEecCCccEEEEEccCCCccccceEhhheecccceEEEEEECCCCcEEEeecCCceEEEEecCC
Confidence 468999999999999999999999999998763 344445 5679999999999 88888999999999654
Q ss_pred CCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCCCceeeec
Q 040274 178 GSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSEPNFDSWV 233 (359)
Q Consensus 178 ~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~~~~~~~~ 233 (359)
.-.....+.+|.. .++.++||.||.||++|+.|+..++|....+. .++.|.
T Consensus 247 ~~kle~~l~gh~r----WvWdc~FS~dg~YlvTassd~~~rlW~~~~~k-~v~qy~ 297 (311)
T KOG0315|consen 247 FFKLELVLTGHQR----WVWDCAFSADGEYLVTASSDHTARLWDLSAGK-EVRQYQ 297 (311)
T ss_pred ceeeEEEeecCCc----eEEeeeeccCccEEEecCCCCceeecccccCc-eeeecC
Confidence 4233334455544 89999999999999999999998888876654 244443
No 36
>KOG0285 consensus Pleiotropic regulator 1 [RNA processing and modification]
Probab=99.87 E-value=1.9e-21 Score=167.44 Aligned_cols=179 Identities=13% Similarity=0.232 Sum_probs=157.2
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h 108 (359)
.|+++.|...++++|+. .|..+++|+-..|+++++.|+.|.-||+...+.+..+.+|
T Consensus 155 r~vavdP~n~wf~tgs~DrtikIwDlatg~LkltltGhi~~vr~vavS~rHpYlFs~gedk~VKCwDLe~nkvIR~YhGH 234 (460)
T KOG0285|consen 155 RSVAVDPGNEWFATGSADRTIKIWDLATGQLKLTLTGHIETVRGVAVSKRHPYLFSAGEDKQVKCWDLEYNKVIRHYHGH 234 (460)
T ss_pred EEEeeCCCceeEEecCCCceeEEEEcccCeEEEeecchhheeeeeeecccCceEEEecCCCeeEEEechhhhhHHHhccc
Confidence 89999999999999887 7899999999999999999999999999999999999999
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecC---CceeEEEcCCC--cEEEEcCCcEEEEcCCCCCcccc
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTG---HAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYS 183 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~---~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~ 183 (359)
-+.|.|++.+|.-..|+||+.|.+++|||+|+...++.+.| +|.++.+.|.. +++++.|++|++||++.+ +...
T Consensus 235 lS~V~~L~lhPTldvl~t~grDst~RvWDiRtr~~V~~l~GH~~~V~~V~~~~~dpqvit~S~D~tvrlWDl~ag-kt~~ 313 (460)
T KOG0285|consen 235 LSGVYCLDLHPTLDVLVTGGRDSTIRVWDIRTRASVHVLSGHTNPVASVMCQPTDPQVITGSHDSTVRLWDLRAG-KTMI 313 (460)
T ss_pred cceeEEEeccccceeEEecCCcceEEEeeecccceEEEecCCCCcceeEEeecCCCceEEecCCceEEEeeeccC-ceeE
Confidence 99999999999999999999999999999999999998865 47888888755 999999999999998766 4444
Q ss_pred ccccccCCCCcceeEEEEccCCCEEEEEeCCCeEE----------------------------EEEcCCCCCceeeeccC
Q 040274 184 RYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSG----------------------------ILVPRSSEPNFDSWVAN 235 (359)
Q Consensus 184 ~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~----------------------------i~~~gs~~~~~~~~~~~ 235 (359)
.+..|.. .|.+++.+|....+++++.|.+-. ++++|++.+.+..|++.
T Consensus 314 tlt~hkk----svral~lhP~e~~fASas~dnik~w~~p~g~f~~nlsgh~~iintl~~nsD~v~~~G~dng~~~fwdwk 389 (460)
T KOG0285|consen 314 TLTHHKK----SVRALCLHPKENLFASASPDNIKQWKLPEGEFLQNLSGHNAIINTLSVNSDGVLVSGGDNGSIMFWDWK 389 (460)
T ss_pred eeecccc----eeeEEecCCchhhhhccCCccceeccCCccchhhccccccceeeeeeeccCceEEEcCCceEEEEEecC
Confidence 4444433 799999999999999988887521 37888888999999875
No 37
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=99.87 E-value=3.6e-21 Score=158.58 Aligned_cols=169 Identities=15% Similarity=0.280 Sum_probs=144.0
Q ss_pred eEEEECCCCCEEEEecc------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeec
Q 040274 52 ILWILPSSGRYMAVAGR------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLY 107 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~ 107 (359)
..++|+.|.++|++|+. .|..+.|....+.|++++.|++|++||.+++..+.++.-
T Consensus 104 k~~af~~ds~~lltgg~ekllrvfdln~p~App~E~~ghtg~Ir~v~wc~eD~~iLSSadd~tVRLWD~rTgt~v~sL~~ 183 (334)
T KOG0278|consen 104 KAVAFSQDSNYLLTGGQEKLLRVFDLNRPKAPPKEISGHTGGIRTVLWCHEDKCILSSADDKTVRLWDHRTGTEVQSLEF 183 (334)
T ss_pred eeEEecccchhhhccchHHHhhhhhccCCCCCchhhcCCCCcceeEEEeccCceEEeeccCCceEEEEeccCcEEEEEec
Confidence 88999999999999997 788999988888888889999999999999999888854
Q ss_pred CCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCcccc
Q 040274 108 HQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYS 183 (359)
Q Consensus 108 h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~ 183 (359)
..+|+++.++++|.+|.++ ..+.|.+||..+..++..+ +..|.+...+|+- +++++.|..++.||..++ ..+.
T Consensus 184 -~s~VtSlEvs~dG~ilTia-~gssV~Fwdaksf~~lKs~k~P~nV~SASL~P~k~~fVaGged~~~~kfDy~Tg-eEi~ 260 (334)
T KOG0278|consen 184 -NSPVTSLEVSQDGRILTIA-YGSSVKFWDAKSFGLLKSYKMPCNVESASLHPKKEFFVAGGEDFKVYKFDYNTG-EEIG 260 (334)
T ss_pred -CCCCcceeeccCCCEEEEe-cCceeEEeccccccceeeccCccccccccccCCCceEEecCcceEEEEEeccCC-ceee
Confidence 7789999999999877554 5577999999999999888 5568899999987 888999999999996665 4444
Q ss_pred cc-ccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCCC
Q 040274 184 RY-MGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSEP 227 (359)
Q Consensus 184 ~~-~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~~ 227 (359)
.+ .+|.+ +|.|+.|+|+|...++|+.||++++|....+..
T Consensus 261 ~~nkgh~g----pVhcVrFSPdGE~yAsGSEDGTirlWQt~~~~~ 301 (334)
T KOG0278|consen 261 SYNKGHFG----PVHCVRFSPDGELYASGSEDGTIRLWQTTPGKT 301 (334)
T ss_pred ecccCCCC----ceEEEEECCCCceeeccCCCceEEEEEecCCCc
Confidence 44 56644 899999999999999999999888887765543
No 38
>KOG0293 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.87 E-value=4e-21 Score=168.23 Aligned_cols=166 Identities=16% Similarity=0.191 Sum_probs=128.8
Q ss_pred eEEEECCCCCEEEEecc--------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEe
Q 040274 52 ILWILPSSGRYMAVAGR--------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKM 105 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~--------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~ 105 (359)
|-+.||++|+|||+++. +|..+.||||.+++++|+.|..+.+||+.+|.....+
T Consensus 228 Wfl~FS~nGkyLAsaSkD~Taiiw~v~~d~~~kl~~tlvgh~~~V~yi~wSPDdryLlaCg~~e~~~lwDv~tgd~~~~y 307 (519)
T KOG0293|consen 228 WFLQFSHNGKYLASASKDSTAIIWIVVYDVHFKLKKTLVGHSQPVSYIMWSPDDRYLLACGFDEVLSLWDVDTGDLRHLY 307 (519)
T ss_pred EEEEEcCCCeeEeeccCCceEEEEEEecCcceeeeeeeecccCceEEEEECCCCCeEEecCchHheeeccCCcchhhhhc
Confidence 89999999999999987 8999999999999999999999999999999887776
Q ss_pred e-cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCC----------------------eeeEe---------e------
Q 040274 106 L-YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKY----------------------EVLQT---------L------ 147 (359)
Q Consensus 106 ~-~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~----------------------~~~~~---------~------ 147 (359)
. +|...+.+++|.|||..|++|+.|++|..||++.. +.+.. +
T Consensus 308 ~~~~~~S~~sc~W~pDg~~~V~Gs~dr~i~~wdlDgn~~~~W~gvr~~~v~dlait~Dgk~vl~v~~d~~i~l~~~e~~~ 387 (519)
T KOG0293|consen 308 PSGLGFSVSSCAWCPDGFRFVTGSPDRTIIMWDLDGNILGNWEGVRDPKVHDLAITYDGKYVLLVTVDKKIRLYNREARV 387 (519)
T ss_pred ccCcCCCcceeEEccCCceeEecCCCCcEEEecCCcchhhcccccccceeEEEEEcCCCcEEEEEecccceeeechhhhh
Confidence 5 44678999999999999999999999999987521 11000 0
Q ss_pred -------cCCceeEEEcCCC-cEE-EEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEcc-CCCEEEEEeCCCeE
Q 040274 148 -------TGHAKTLDFSQKG-LLA-VGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRP-YEDVLGIGHSMGWS 217 (359)
Q Consensus 148 -------~~~v~~~~~s~~g-l~~-~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp-~~~~l~~g~~dg~~ 217 (359)
..+++++++|.+| ++. .-.+..+++||+. ....+..|.+|.. .. -+-.-+|.- +..++++|+.|+.+
T Consensus 388 dr~lise~~~its~~iS~d~k~~LvnL~~qei~LWDl~-e~~lv~kY~Ghkq-~~-fiIrSCFgg~~~~fiaSGSED~kv 464 (519)
T KOG0293|consen 388 DRGLISEEQPITSFSISKDGKLALVNLQDQEIHLWDLE-ENKLVRKYFGHKQ-GH-FIIRSCFGGGNDKFIASGSEDSKV 464 (519)
T ss_pred hhccccccCceeEEEEcCCCcEEEEEcccCeeEEeecc-hhhHHHHhhcccc-cc-eEEEeccCCCCcceEEecCCCceE
Confidence 1235677777777 333 3356778888865 4467778888864 22 344445554 55899999999998
Q ss_pred EEE
Q 040274 218 GIL 220 (359)
Q Consensus 218 ~i~ 220 (359)
.||
T Consensus 465 yIW 467 (519)
T KOG0293|consen 465 YIW 467 (519)
T ss_pred EEE
Confidence 884
No 39
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.87 E-value=6.1e-21 Score=178.16 Aligned_cols=168 Identities=20% Similarity=0.275 Sum_probs=147.1
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h 108 (359)
.++++||||.++++|+. .|+.+.|+..|+.+++.|-||+|+.||+.....-.+|.+.
T Consensus 354 ~~l~YSpDgq~iaTG~eDgKVKvWn~~SgfC~vTFteHts~Vt~v~f~~~g~~llssSLDGtVRAwDlkRYrNfRTft~P 433 (893)
T KOG0291|consen 354 TSLAYSPDGQLIATGAEDGKVKVWNTQSGFCFVTFTEHTSGVTAVQFTARGNVLLSSSLDGTVRAWDLKRYRNFRTFTSP 433 (893)
T ss_pred eeEEECCCCcEEEeccCCCcEEEEeccCceEEEEeccCCCceEEEEEEecCCEEEEeecCCeEEeeeecccceeeeecCC
Confidence 89999999999999998 8999999999999999999999999999998888888753
Q ss_pred C-CCeEEEEEecCCCEEEEecCCC-eEEEEEcCCCeeeEee---cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCcc
Q 040274 109 Q-GPVSALAFHPNGHLMATTGKEC-KIKIWDLRKYEVLQTL---TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHN 181 (359)
Q Consensus 109 ~-~~v~~l~~~p~g~~l~s~~~d~-~i~vwd~~~~~~~~~~---~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~ 181 (359)
. -...|++..|.|.+++.|+.|. .|++|++.+|+.+-.+ .++|.+++|+|+| ++++++|.+|++||+......
T Consensus 434 ~p~QfscvavD~sGelV~AG~~d~F~IfvWS~qTGqllDiLsGHEgPVs~l~f~~~~~~LaS~SWDkTVRiW~if~s~~~ 513 (893)
T KOG0291|consen 434 EPIQFSCVAVDPSGELVCAGAQDSFEIFVWSVQTGQLLDILSGHEGPVSGLSFSPDGSLLASGSWDKTVRIWDIFSSSGT 513 (893)
T ss_pred CceeeeEEEEcCCCCEEEeeccceEEEEEEEeecCeeeehhcCCCCcceeeEEccccCeEEeccccceEEEEEeeccCce
Confidence 3 3567899999999999998886 5999999999998877 5679999999999 889999999999998766555
Q ss_pred ccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCC
Q 040274 182 YSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRS 224 (359)
Q Consensus 182 ~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs 224 (359)
..++.... .+..++|+|+|+.|++++-||.+.+|.+-.
T Consensus 514 vEtl~i~s-----dvl~vsfrPdG~elaVaTldgqItf~d~~~ 551 (893)
T KOG0291|consen 514 VETLEIRS-----DVLAVSFRPDGKELAVATLDGQITFFDIKE 551 (893)
T ss_pred eeeEeecc-----ceeEEEEcCCCCeEEEEEecceEEEEEhhh
Confidence 55554432 699999999999999999999999987543
No 40
>KOG0282 consensus mRNA splicing factor [Function unknown]
Probab=99.87 E-value=1.2e-21 Score=174.73 Aligned_cols=167 Identities=20% Similarity=0.324 Sum_probs=138.2
Q ss_pred eEEEECC-CCCEEEEecc------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee
Q 040274 52 ILWILPS-SGRYMAVAGR------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML 106 (359)
Q Consensus 52 ~~l~~sp-dg~~l~~~~~------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~ 106 (359)
.++.|.| .|.+|++++- +|..++|+++|..|++++.|+.|++||+.||+++..|.
T Consensus 218 sai~~fp~~~hLlLS~gmD~~vklW~vy~~~~~lrtf~gH~k~Vrd~~~s~~g~~fLS~sfD~~lKlwDtETG~~~~~f~ 297 (503)
T KOG0282|consen 218 SAIQWFPKKGHLLLSGGMDGLVKLWNVYDDRRCLRTFKGHRKPVRDASFNNCGTSFLSASFDRFLKLWDTETGQVLSRFH 297 (503)
T ss_pred chhhhccceeeEEEecCCCceEEEEEEecCcceehhhhcchhhhhhhhccccCCeeeeeecceeeeeeccccceEEEEEe
Confidence 6777778 7878888776 89999999999999999999999999999999999885
Q ss_pred cCCCCeEEEEEecCC-CEEEEecCCCeEEEEEcCCCeeeEeec---CCceeEEEcCCC--cEEEEcCCcEEEEcCCCCC-
Q 040274 107 YHQGPVSALAFHPNG-HLMATTGKECKIKIWDLRKYEVLQTLT---GHAKTLDFSQKG--LLAVGTGSFAQILGDFSGS- 179 (359)
Q Consensus 107 ~h~~~v~~l~~~p~g-~~l~s~~~d~~i~vwd~~~~~~~~~~~---~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~- 179 (359)
. ...++|+.|+|++ +.|++|+.|+.|+.||+|+++.++++. +.|..+.|-++| +++++.|++++||+...+-
T Consensus 298 ~-~~~~~cvkf~pd~~n~fl~G~sd~ki~~wDiRs~kvvqeYd~hLg~i~~i~F~~~g~rFissSDdks~riWe~~~~v~ 376 (503)
T KOG0282|consen 298 L-DKVPTCVKFHPDNQNIFLVGGSDKKIRQWDIRSGKVVQEYDRHLGAILDITFVDEGRRFISSSDDKSVRIWENRIPVP 376 (503)
T ss_pred c-CCCceeeecCCCCCcEEEEecCCCcEEEEeccchHHHHHHHhhhhheeeeEEccCCceEeeeccCccEEEEEcCCCcc
Confidence 4 5667999999988 889999999999999999999999984 568999999999 8899999999999854320
Q ss_pred --------------------------------------------ccccccccccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 180 --------------------------------------------HNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 180 --------------------------------------------~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
.....+.+|.. .+. -+.+.|||||++|++|..+|
T Consensus 377 ik~i~~~~~hsmP~~~~~P~~~~~~aQs~dN~i~ifs~~~~~r~nkkK~feGh~v-aGy-s~~v~fSpDG~~l~SGdsdG 454 (503)
T KOG0282|consen 377 IKNIADPEMHTMPCLTLHPNGKWFAAQSMDNYIAIFSTVPPFRLNKKKRFEGHSV-AGY-SCQVDFSPDGRTLCSGDSDG 454 (503)
T ss_pred chhhcchhhccCcceecCCCCCeehhhccCceEEEEecccccccCHhhhhcceec-cCc-eeeEEEcCCCCeEEeecCCc
Confidence 00112334432 333 45689999999999999999
Q ss_pred eEEEEE
Q 040274 216 WSGILV 221 (359)
Q Consensus 216 ~~~i~~ 221 (359)
.+.+|.
T Consensus 455 ~v~~wd 460 (503)
T KOG0282|consen 455 KVNFWD 460 (503)
T ss_pred cEEEee
Confidence 888764
No 41
>KOG0319 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.87 E-value=5.1e-21 Score=178.32 Aligned_cols=151 Identities=19% Similarity=0.326 Sum_probs=138.4
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
.|+|++++|+..+|+|||.|.+..||++.....+.++.+|+..|+++.|+|....++|+|.|++|+||.+.++.|+.+|.
T Consensus 465 dIN~Vaia~ndkLiAT~SqDktaKiW~le~~~l~~vLsGH~RGvw~V~Fs~~dq~laT~SgD~TvKIW~is~fSClkT~e 544 (775)
T KOG0319|consen 465 DINCVAIAPNDKLIATGSQDKTAKIWDLEQLRLLGVLSGHTRGVWCVSFSKNDQLLATCSGDKTVKIWSISTFSCLKTFE 544 (775)
T ss_pred cccceEecCCCceEEecccccceeeecccCceEEEEeeCCccceEEEEeccccceeEeccCCceEEEEEeccceeeeeec
Confidence 89999999999999999999999999999989999999999999999999999999999999999999999999999997
Q ss_pred CC---ceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 149 GH---AKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 149 ~~---v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
|| |..+.|-.+| +++++.||-|.+|++.+. .....+..|.. .|++++.+|.+..+++|+.||.+.+|-..
T Consensus 545 GH~~aVlra~F~~~~~qliS~~adGliKlWnikt~-eC~~tlD~H~D----rvWaL~~~~~~~~~~tgg~Dg~i~~wkD~ 619 (775)
T KOG0319|consen 545 GHTSAVLRASFIRNGKQLISAGADGLIKLWNIKTN-ECEMTLDAHND----RVWALSVSPLLDMFVTGGGDGRIIFWKDV 619 (775)
T ss_pred CccceeEeeeeeeCCcEEEeccCCCcEEEEeccch-hhhhhhhhccc----eeEEEeecCccceeEecCCCeEEEEeecC
Confidence 76 6778898888 999999999999996554 77778888865 89999999999999999999988877654
Q ss_pred C
Q 040274 224 S 224 (359)
Q Consensus 224 s 224 (359)
+
T Consensus 620 T 620 (775)
T KOG0319|consen 620 T 620 (775)
T ss_pred c
Confidence 3
No 42
>PTZ00420 coronin; Provisional
Probab=99.87 E-value=1.6e-20 Score=179.53 Aligned_cols=166 Identities=14% Similarity=0.169 Sum_probs=129.8
Q ss_pred ceeEEEEcCC-CCEEEEEeCCCeEEEEeCCCCc--------ceEEeecCCCCeEEEEEecCCCE-EEEecCCCeEEEEEc
Q 040274 69 RTDLMRVNPF-NGVVSLGHSGGTVTMWKPTTSA--------LLIKMLYHQGPVSALAFHPNGHL-MATTGKECKIKIWDL 138 (359)
Q Consensus 69 ~v~~l~~sp~-~~~l~tg~~dg~v~lwd~~~~~--------~~~~~~~h~~~v~~l~~~p~g~~-l~s~~~d~~i~vwd~ 138 (359)
.|.+++|+|+ +.+|++|+.||+|+|||+.++. ++..+.+|...|.+++|+|++.. |++++.|++|++||+
T Consensus 76 ~V~~lafsP~~~~lLASgS~DgtIrIWDi~t~~~~~~~i~~p~~~L~gH~~~V~sVaf~P~g~~iLaSgS~DgtIrIWDl 155 (568)
T PTZ00420 76 SILDLQFNPCFSEILASGSEDLTIRVWEIPHNDESVKEIKDPQCILKGHKKKISIIDWNPMNYYIMCSSGFDSFVNIWDI 155 (568)
T ss_pred CEEEEEEcCCCCCEEEEEeCCCeEEEEECCCCCccccccccceEEeecCCCcEEEEEECCCCCeEEEEEeCCCeEEEEEC
Confidence 7999999996 7899999999999999997642 34567899999999999998876 578999999999999
Q ss_pred CCCeeeEee--cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCC-CcceeEEEEccCCCEEEEEeC
Q 040274 139 RKYEVLQTL--TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVK-GYQIGKVSFRPYEDVLGIGHS 213 (359)
Q Consensus 139 ~~~~~~~~~--~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~-~~~v~~~~~sp~~~~l~~g~~ 213 (359)
++++.+..+ ...|.+++|+|+| +++++.|+.|+|||++.+ .....+.+|.+.. ...++...|++++.+|++++.
T Consensus 156 ~tg~~~~~i~~~~~V~SlswspdG~lLat~s~D~~IrIwD~Rsg-~~i~tl~gH~g~~~s~~v~~~~fs~d~~~IlTtG~ 234 (568)
T PTZ00420 156 ENEKRAFQINMPKKLSSLKWNIKGNLLSGTCVGKHMHIIDPRKQ-EIASSFHIHDGGKNTKNIWIDGLGGDDNYILSTGF 234 (568)
T ss_pred CCCcEEEEEecCCcEEEEEECCCCCEEEEEecCCEEEEEECCCC-cEEEEEecccCCceeEEEEeeeEcCCCCEEEEEEc
Confidence 998876665 4568999999999 555667999999997665 5555666674310 011233456689999988776
Q ss_pred CC----eEEE---------------------------------EEcCCCCCceeeeccC
Q 040274 214 MG----WSGI---------------------------------LVPRSSEPNFDSWVAN 235 (359)
Q Consensus 214 dg----~~~i---------------------------------~~~gs~~~~~~~~~~~ 235 (359)
++ .+.| ++.|++|+++++|++.
T Consensus 235 d~~~~R~VkLWDlr~~~~pl~~~~ld~~~~~L~p~~D~~tg~l~lsGkGD~tIr~~e~~ 293 (568)
T PTZ00420 235 SKNNMREMKLWDLKNTTSALVTMSIDNASAPLIPHYDESTGLIYLIGKGDGNCRYYQHS 293 (568)
T ss_pred CCCCccEEEEEECCCCCCceEEEEecCCccceEEeeeCCCCCEEEEEECCCeEEEEEcc
Confidence 64 3333 4567889999999874
No 43
>KOG0282 consensus mRNA splicing factor [Function unknown]
Probab=99.87 E-value=5.8e-22 Score=176.63 Aligned_cols=146 Identities=17% Similarity=0.194 Sum_probs=135.0
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCC-CcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEe
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTT-SALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQT 146 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~-~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~ 146 (359)
.|+++.|.| .+.+|++|+.|+.|.||++.. +.++.+|.+|..+|.+++|+++|..|+|+|-|+.|++||..+|+++..
T Consensus 216 gvsai~~fp~~~hLlLS~gmD~~vklW~vy~~~~~lrtf~gH~k~Vrd~~~s~~g~~fLS~sfD~~lKlwDtETG~~~~~ 295 (503)
T KOG0282|consen 216 GVSAIQWFPKKGHLLLSGGMDGLVKLWNVYDDRRCLRTFKGHRKPVRDASFNNCGTSFLSASFDRFLKLWDTETGQVLSR 295 (503)
T ss_pred ccchhhhccceeeEEEecCCCceEEEEEEecCcceehhhhcchhhhhhhhccccCCeeeeeecceeeeeeccccceEEEE
Confidence 899999999 889999999999999999876 889999999999999999999999999999999999999999999999
Q ss_pred e--cCCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 147 L--TGHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 147 ~--~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
+ ...++|+.|.|++ +++|+.|+.|..||++.+ ..+..|..|-+ .|..+.|-++|..+++.++|+.++|
T Consensus 296 f~~~~~~~cvkf~pd~~n~fl~G~sd~ki~~wDiRs~-kvvqeYd~hLg----~i~~i~F~~~g~rFissSDdks~ri 368 (503)
T KOG0282|consen 296 FHLDKVPTCVKFHPDNQNIFLVGGSDKKIRQWDIRSG-KVVQEYDRHLG----AILDITFVDEGRRFISSSDDKSVRI 368 (503)
T ss_pred EecCCCceeeecCCCCCcEEEEecCCCcEEEEeccch-HHHHHHHhhhh----heeeeEEccCCceEeeeccCccEEE
Confidence 8 3457999999998 889999999999997766 68888888765 8999999999999999999998877
No 44
>KOG0640 consensus mRNA cleavage stimulating factor complex; subunit 1 [RNA processing and modification]
Probab=99.87 E-value=4.1e-21 Score=162.70 Aligned_cols=173 Identities=13% Similarity=0.236 Sum_probs=145.8
Q ss_pred eEEEECCCCCEEEEecc-----------------------------------------ceeEEEEcCCCCEEEEEeCCCe
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------------------------RTDLMRVNPFNGVVSLGHSGGT 90 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------------------------~v~~l~~sp~~~~l~tg~~dg~ 90 (359)
.+.+|||||.++++|+. .|+++.|+|...+|++|+.|++
T Consensus 116 R~aafs~DG~lvATGsaD~SIKildvermlaks~~~em~~~~~qa~hPvIRTlYDH~devn~l~FHPre~ILiS~srD~t 195 (430)
T KOG0640|consen 116 RAAAFSPDGSLVATGSADASIKILDVERMLAKSKPKEMISGDTQARHPVIRTLYDHVDEVNDLDFHPRETILISGSRDNT 195 (430)
T ss_pred eeeeeCCCCcEEEccCCcceEEEeehhhhhhhcchhhhccCCcccCCceEeehhhccCcccceeecchhheEEeccCCCe
Confidence 77889999999999987 8999999999999999999999
Q ss_pred EEEEeCCCCcceE--EeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee------cCCceeEEEcCCC--
Q 040274 91 VTMWKPTTSALLI--KMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL------TGHAKTLDFSQKG-- 160 (359)
Q Consensus 91 v~lwd~~~~~~~~--~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~------~~~v~~~~~s~~g-- 160 (359)
|.++|........ .......+|.+++|+|.|.+|+.|....++++||+.+.++...- .+.|+++.+|++|
T Consensus 196 vKlFDfsK~saKrA~K~~qd~~~vrsiSfHPsGefllvgTdHp~~rlYdv~T~QcfvsanPd~qht~ai~~V~Ys~t~~l 275 (430)
T KOG0640|consen 196 VKLFDFSKTSAKRAFKVFQDTEPVRSISFHPSGEFLLVGTDHPTLRLYDVNTYQCFVSANPDDQHTGAITQVRYSSTGSL 275 (430)
T ss_pred EEEEecccHHHHHHHHHhhccceeeeEeecCCCceEEEecCCCceeEEeccceeEeeecCcccccccceeEEEecCCccE
Confidence 9999987543222 22244678999999999999999999999999999999886554 3568999999999
Q ss_pred cEEEEcCCcEEEEcCCCCCccccccc-cccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCCCc
Q 040274 161 LLAVGTGSFAQILGDFSGSHNYSRYM-GNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSEPN 228 (359)
Q Consensus 161 l~~~~~d~~i~v~d~~~~~~~~~~~~-~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~~~ 228 (359)
+++++.||.|++||-..+ ..+..+. .| .++.|++..|..+|+||++.+.|..+.+|--+++...
T Consensus 276 YvTaSkDG~IklwDGVS~-rCv~t~~~AH---~gsevcSa~Ftkn~kyiLsSG~DS~vkLWEi~t~R~l 340 (430)
T KOG0640|consen 276 YVTASKDGAIKLWDGVSN-RCVRTIGNAH---GGSEVCSAVFTKNGKYILSSGKDSTVKLWEISTGRML 340 (430)
T ss_pred EEEeccCCcEEeeccccH-HHHHHHHhhc---CCceeeeEEEccCCeEEeecCCcceeeeeeecCCceE
Confidence 889999999999995444 4555543 44 4578999999999999999999999999987776543
No 45
>KOG0641 consensus WD40 repeat protein [General function prediction only]
Probab=99.86 E-value=5.4e-20 Score=149.60 Aligned_cols=162 Identities=16% Similarity=0.141 Sum_probs=135.2
Q ss_pred eEEEECCCCCEEEEecc----------------------------ceeEEEEcC----CCCEEEEEe-CCCeEEEEeCCC
Q 040274 52 ILWILPSSGRYMAVAGR----------------------------RTDLMRVNP----FNGVVSLGH-SGGTVTMWKPTT 98 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~----------------------------~v~~l~~sp----~~~~l~tg~-~dg~v~lwd~~~ 98 (359)
||.+|||+|.+|++|+. .|..|+|-. .+.+|++++ .|..|++-|..+
T Consensus 93 yc~~ws~~geliatgsndk~ik~l~fn~dt~~~~g~dle~nmhdgtirdl~fld~~~s~~~il~s~gagdc~iy~tdc~~ 172 (350)
T KOG0641|consen 93 YCTAWSPCGELIATGSNDKTIKVLPFNADTCNATGHDLEFNMHDGTIRDLAFLDDPESGGAILASAGAGDCKIYITDCGR 172 (350)
T ss_pred EEEEecCccCeEEecCCCceEEEEecccccccccCcceeeeecCCceeeeEEecCCCcCceEEEecCCCcceEEEeecCC
Confidence 99999999999999987 788888843 244666655 467788889999
Q ss_pred CcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec----------CCceeEEEcCCC--cEEEEc
Q 040274 99 SALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT----------GHAKTLDFSQKG--LLAVGT 166 (359)
Q Consensus 99 ~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~----------~~v~~~~~s~~g--l~~~~~ 166 (359)
|+....+.+|++.|.++. +=+|-++++|+.|.+|++||++-..++.++. ..|.+++..|.| ++++-.
T Consensus 173 g~~~~a~sghtghilaly-swn~~m~~sgsqdktirfwdlrv~~~v~~l~~~~~~~glessavaav~vdpsgrll~sg~~ 251 (350)
T KOG0641|consen 173 GQGFHALSGHTGHILALY-SWNGAMFASGSQDKTIRFWDLRVNSCVNTLDNDFHDGGLESSAVAAVAVDPSGRLLASGHA 251 (350)
T ss_pred CCcceeecCCcccEEEEE-EecCcEEEccCCCceEEEEeeeccceeeeccCcccCCCcccceeEEEEECCCcceeeeccC
Confidence 999999999999998873 3367899999999999999999998888871 347899999999 555557
Q ss_pred CCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 167 GSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 167 d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
|..+.+||++. +..+..+..|.. .|.|+.|+|...||++++.|..+.+
T Consensus 252 dssc~lydirg-~r~iq~f~phsa----dir~vrfsp~a~yllt~syd~~ikl 299 (350)
T KOG0641|consen 252 DSSCMLYDIRG-GRMIQRFHPHSA----DIRCVRFSPGAHYLLTCSYDMKIKL 299 (350)
T ss_pred CCceEEEEeeC-CceeeeeCCCcc----ceeEEEeCCCceEEEEecccceEEE
Confidence 89999999654 467777766654 8999999999999999999998776
No 46
>KOG0276 consensus Vesicle coat complex COPI, beta' subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.86 E-value=8.9e-21 Score=173.75 Aligned_cols=152 Identities=19% Similarity=0.247 Sum_probs=137.1
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCC-cceEEeecCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCCCeeeEe
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTS-ALLIKMLYHQGPVSALAFHP-NGHLMATTGKECKIKIWDLRKYEVLQT 146 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~-~~~~~~~~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~~~~~~~ 146 (359)
.|.|++.||.-.+++|+|.|-+|++||.... .+.++|.+|...|.+++|+| |.+.|++++.|++|+||.+-+..+..+
T Consensus 99 yIR~iavHPt~P~vLtsSDDm~iKlW~we~~wa~~qtfeGH~HyVMqv~fnPkD~ntFaS~sLDrTVKVWslgs~~~nfT 178 (794)
T KOG0276|consen 99 YIRSIAVHPTLPYVLTSSDDMTIKLWDWENEWACEQTFEGHEHYVMQVAFNPKDPNTFASASLDRTVKVWSLGSPHPNFT 178 (794)
T ss_pred ceeeeeecCCCCeEEecCCccEEEEeeccCceeeeeEEcCcceEEEEEEecCCCccceeeeeccccEEEEEcCCCCCcee
Confidence 7999999999999999999999999998854 78889999999999999999 778899999999999999998888888
Q ss_pred ecCC---ceeEEEcCCC----cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 147 LTGH---AKTLDFSQKG----LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 147 ~~~~---v~~~~~s~~g----l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
+.+| |+|++|-+.| +++++.|.+|.|||. .....+.++.+|.. .|+.+.|+|.-.++++|+.||+++|
T Consensus 179 l~gHekGVN~Vdyy~~gdkpylIsgaDD~tiKvWDy-Qtk~CV~TLeGHt~----Nvs~v~fhp~lpiiisgsEDGTvri 253 (794)
T KOG0276|consen 179 LEGHEKGVNCVDYYTGGDKPYLISGADDLTIKVWDY-QTKSCVQTLEGHTN----NVSFVFFHPELPIIISGSEDGTVRI 253 (794)
T ss_pred eeccccCcceEEeccCCCcceEEecCCCceEEEeec-chHHHHHHhhcccc----cceEEEecCCCcEEEEecCCccEEE
Confidence 8665 8999999988 888889999999994 44578888888865 7999999999999999999999999
Q ss_pred EEcCCC
Q 040274 220 LVPRSS 225 (359)
Q Consensus 220 ~~~gs~ 225 (359)
|.+.+-
T Consensus 254 Whs~Ty 259 (794)
T KOG0276|consen 254 WNSKTY 259 (794)
T ss_pred ecCcce
Confidence 977653
No 47
>KOG0306 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.86 E-value=8.9e-21 Score=176.99 Aligned_cols=165 Identities=13% Similarity=0.179 Sum_probs=148.3
Q ss_pred eEEEECCCCCEEEEecc-----------------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKP 96 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~ 96 (359)
|+++.+||++.+++|+. .|.|+.+|||+.+|+++--|.+|.||-+
T Consensus 458 Wsi~~~pD~~g~vT~saDktVkfWdf~l~~~~~gt~~k~lsl~~~rtLel~ddvL~v~~Spdgk~LaVsLLdnTVkVyfl 537 (888)
T KOG0306|consen 458 WSISLSPDNKGFVTGSADKTVKFWDFKLVVSVPGTQKKVLSLKHTRTLELEDDVLCVSVSPDGKLLAVSLLDNTVKVYFL 537 (888)
T ss_pred eeeeecCCCCceEEecCCcEEEEEeEEEEeccCcccceeeeeccceEEeccccEEEEEEcCCCcEEEEEeccCeEEEEEe
Confidence 99999999999999987 7999999999999999999999999999
Q ss_pred CCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee---cCCceeEEEcCCC--cEEEEcCCcEE
Q 040274 97 TTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL---TGHAKTLDFSQKG--LLAVGTGSFAQ 171 (359)
Q Consensus 97 ~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~---~~~v~~~~~s~~g--l~~~~~d~~i~ 171 (359)
++-+.-.++.||.-||.|+..+||+++++|||.|.+|++|-+.=|.|-.++ .+.|.++.|.|.. ++++|.|+.|.
T Consensus 538 DtlKFflsLYGHkLPV~smDIS~DSklivTgSADKnVKiWGLdFGDCHKS~fAHdDSvm~V~F~P~~~~FFt~gKD~kvK 617 (888)
T KOG0306|consen 538 DTLKFFLSLYGHKLPVLSMDISPDSKLIVTGSADKNVKIWGLDFGDCHKSFFAHDDSVMSVQFLPKTHLFFTCGKDGKVK 617 (888)
T ss_pred cceeeeeeecccccceeEEeccCCcCeEEeccCCCceEEeccccchhhhhhhcccCceeEEEEcccceeEEEecCcceEE
Confidence 999999999999999999999999999999999999999999999988777 4679999999988 89999999999
Q ss_pred EEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 172 ILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 172 v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
-|| ...-..+..+.+|.. .|+|++.+|+|.++++++.|..+++|-
T Consensus 618 qWD-g~kFe~iq~L~~H~~----ev~cLav~~~G~~vvs~shD~sIRlwE 662 (888)
T KOG0306|consen 618 QWD-GEKFEEIQKLDGHHS----EVWCLAVSPNGSFVVSSSHDKSIRLWE 662 (888)
T ss_pred eec-hhhhhhheeeccchh----eeeeeEEcCCCCeEEeccCCceeEeee
Confidence 999 344456667777754 799999999999998888777444443
No 48
>KOG0318 consensus WD40 repeat stress protein/actin interacting protein [Cytoskeleton]
Probab=99.86 E-value=5.6e-20 Score=165.57 Aligned_cols=87 Identities=20% Similarity=0.298 Sum_probs=78.3
Q ss_pred eEEEECCCCCEEEEecc--------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCc-----
Q 040274 52 ILWILPSSGRYMAVAGR--------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSA----- 100 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~--------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~----- 100 (359)
.|+.|+|||.++++.|. .|.+++|+||+..|+|++.|.+++|||+.+..
T Consensus 194 ~~VRysPDG~~Fat~gsDgki~iyDGktge~vg~l~~~~aHkGsIfalsWsPDs~~~~T~SaDkt~KIWdVs~~slv~t~ 273 (603)
T KOG0318|consen 194 NCVRYSPDGSRFATAGSDGKIYIYDGKTGEKVGELEDSDAHKGSIFALSWSPDSTQFLTVSADKTIKIWDVSTNSLVSTW 273 (603)
T ss_pred eeEEECCCCCeEEEecCCccEEEEcCCCccEEEEecCCCCccccEEEEEECCCCceEEEecCCceEEEEEeeccceEEEe
Confidence 89999999999999887 89999999999999999999999999986543
Q ss_pred --------------------------------------ceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEc
Q 040274 101 --------------------------------------LLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDL 138 (359)
Q Consensus 101 --------------------------------------~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~ 138 (359)
++..+.+|...|++++.+|++.+|++|+.||.|.-||+
T Consensus 274 ~~~~~v~dqqvG~lWqkd~lItVSl~G~in~ln~~d~~~~~~i~GHnK~ITaLtv~~d~~~i~SgsyDG~I~~W~~ 349 (603)
T KOG0318|consen 274 PMGSTVEDQQVGCLWQKDHLITVSLSGTINYLNPSDPSVLKVISGHNKSITALTVSPDGKTIYSGSYDGHINSWDS 349 (603)
T ss_pred ecCCchhceEEEEEEeCCeEEEEEcCcEEEEecccCCChhheecccccceeEEEEcCCCCEEEeeccCceEEEEec
Confidence 33345688999999999999999999999999999984
No 49
>KOG0275 consensus Conserved WD40 repeat-containing protein [General function prediction only]
Probab=99.86 E-value=7.2e-22 Score=168.15 Aligned_cols=154 Identities=19% Similarity=0.318 Sum_probs=136.7
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceE--------EeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLI--------KMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRK 140 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~--------~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~ 140 (359)
.+-|..|||||++|++|+-||.|.+|+..+|+... .|..|..+|.|++|+.|..++++|+.||.|++|.+.+
T Consensus 215 h~EcA~FSPDgqyLvsgSvDGFiEVWny~~GKlrKDLkYQAqd~fMMmd~aVlci~FSRDsEMlAsGsqDGkIKvWri~t 294 (508)
T KOG0275|consen 215 HVECARFSPDGQYLVSGSVDGFIEVWNYTTGKLRKDLKYQAQDNFMMMDDAVLCISFSRDSEMLASGSQDGKIKVWRIET 294 (508)
T ss_pred chhheeeCCCCceEeeccccceeeeehhccchhhhhhhhhhhcceeecccceEEEeecccHHHhhccCcCCcEEEEEEec
Confidence 78899999999999999999999999999886543 3446788999999999999999999999999999999
Q ss_pred CeeeEeec----CCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 141 YEVLQTLT----GHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 141 ~~~~~~~~----~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
|.|++.|. ..|+|+.||.|+ +++++.|.+++|.-+.. ++.+..+.+|.. -|+.+.|.++|..+++++.|
T Consensus 295 G~ClRrFdrAHtkGvt~l~FSrD~SqiLS~sfD~tvRiHGlKS-GK~LKEfrGHsS----yvn~a~ft~dG~~iisaSsD 369 (508)
T KOG0275|consen 295 GQCLRRFDRAHTKGVTCLSFSRDNSQILSASFDQTVRIHGLKS-GKCLKEFRGHSS----YVNEATFTDDGHHIISASSD 369 (508)
T ss_pred chHHHHhhhhhccCeeEEEEccCcchhhcccccceEEEecccc-chhHHHhcCccc----cccceEEcCCCCeEEEecCC
Confidence 99999993 358999999999 99999999999998644 477777777754 79999999999999999999
Q ss_pred CeEEEEEcCCCCC
Q 040274 215 GWSGILVPRSSEP 227 (359)
Q Consensus 215 g~~~i~~~gs~~~ 227 (359)
|.+.+|..-+.++
T Consensus 370 gtvkvW~~KtteC 382 (508)
T KOG0275|consen 370 GTVKVWHGKTTEC 382 (508)
T ss_pred ccEEEecCcchhh
Confidence 9999998776654
No 50
>KOG0264 consensus Nucleosome remodeling factor, subunit CAF1/NURF55/MSI1 [Chromatin structure and dynamics]
Probab=99.86 E-value=8.4e-21 Score=168.16 Aligned_cols=153 Identities=18% Similarity=0.255 Sum_probs=125.7
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCC--CCcceEEeecCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCCC-ee
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPT--TSALLIKMLYHQGPVSALAFHP-NGHLMATTGKECKIKIWDLRKY-EV 143 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~--~~~~~~~~~~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~~-~~ 143 (359)
.|..++|+| +..+|++++.|+.+.|||++ +.++.....+|.+.|+|++|+| ++.+|||||.|++|.+||+|+. .+
T Consensus 229 ~VeDV~~h~~h~~lF~sv~dd~~L~iwD~R~~~~~~~~~~~ah~~~vn~~~fnp~~~~ilAT~S~D~tV~LwDlRnL~~~ 308 (422)
T KOG0264|consen 229 VVEDVAWHPLHEDLFGSVGDDGKLMIWDTRSNTSKPSHSVKAHSAEVNCVAFNPFNEFILATGSADKTVALWDLRNLNKP 308 (422)
T ss_pred ceehhhccccchhhheeecCCCeEEEEEcCCCCCCCcccccccCCceeEEEeCCCCCceEEeccCCCcEEEeechhcccC
Confidence 789999999 56789999999999999999 5667777889999999999999 6778999999999999999985 46
Q ss_pred eEeecC---CceeEEEcCCC---cEEEEcCCcEEEEcCCCCCc----------cccccccccCCCCcceeEEEEccCCCE
Q 040274 144 LQTLTG---HAKTLDFSQKG---LLAVGTGSFAQILGDFSGSH----------NYSRYMGNSMVKGYQIGKVSFRPYEDV 207 (359)
Q Consensus 144 ~~~~~~---~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~----------~~~~~~~~~~~~~~~v~~~~~sp~~~~ 207 (359)
++++.+ .|.++.|||+. +++++.|+.+.|||+..-+. +...+..|.+ |...|..+.|+|...+
T Consensus 309 lh~~e~H~dev~~V~WSPh~etvLASSg~D~rl~vWDls~ig~eq~~eda~dgppEllF~HgG-H~~kV~DfsWnp~ePW 387 (422)
T KOG0264|consen 309 LHTFEGHEDEVFQVEWSPHNETVLASSGTDRRLNVWDLSRIGEEQSPEDAEDGPPELLFIHGG-HTAKVSDFSWNPNEPW 387 (422)
T ss_pred ceeccCCCcceEEEEeCCCCCceeEecccCCcEEEEeccccccccChhhhccCCcceeEEecC-cccccccccCCCCCCe
Confidence 788854 48999999987 77778899999999754322 2345677777 7778999999999876
Q ss_pred -EEEEeCCCeEEEEEc
Q 040274 208 -LGIGHSMGWSGILVP 222 (359)
Q Consensus 208 -l~~g~~dg~~~i~~~ 222 (359)
|++.+.|+++.||-+
T Consensus 388 ~I~SvaeDN~LqIW~~ 403 (422)
T KOG0264|consen 388 TIASVAEDNILQIWQM 403 (422)
T ss_pred EEEEecCCceEEEeec
Confidence 456666666666554
No 51
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=99.86 E-value=1.1e-20 Score=155.77 Aligned_cols=165 Identities=15% Similarity=0.209 Sum_probs=143.1
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCC-cceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTS-ALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~-~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~ 147 (359)
-|.+++|+.|..+|++|+.+..++|||++.. .+...+.+|++.|..+-|....+.+++++.|++|++||.+++..++++
T Consensus 102 ivk~~af~~ds~~lltgg~ekllrvfdln~p~App~E~~ghtg~Ir~v~wc~eD~~iLSSadd~tVRLWD~rTgt~v~sL 181 (334)
T KOG0278|consen 102 IVKAVAFSQDSNYLLTGGQEKLLRVFDLNRPKAPPKEISGHTGGIRTVLWCHEDKCILSSADDKTVRLWDHRTGTEVQSL 181 (334)
T ss_pred eeeeEEecccchhhhccchHHHhhhhhccCCCCCchhhcCCCCcceeEEEeccCceEEeeccCCceEEEEeccCcEEEEE
Confidence 6899999999999999999999999999875 456678899999999999998899999999999999999999999988
Q ss_pred --cCCceeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE-----
Q 040274 148 --TGHAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI----- 219 (359)
Q Consensus 148 --~~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i----- 219 (359)
+.+|+++.++++| +++.+..+.|.+||...- ..+..+.... .|.+.+.+|+..++++|+.|+.+..
T Consensus 182 ~~~s~VtSlEvs~dG~ilTia~gssV~Fwdaksf-~~lKs~k~P~-----nV~SASL~P~k~~fVaGged~~~~kfDy~T 255 (334)
T KOG0278|consen 182 EFNSPVTSLEVSQDGRILTIAYGSSVKFWDAKSF-GLLKSYKMPC-----NVESASLHPKKEFFVAGGEDFKVYKFDYNT 255 (334)
T ss_pred ecCCCCcceeeccCCCEEEEecCceeEEeccccc-cceeeccCcc-----ccccccccCCCceEEecCcceEEEEEeccC
Confidence 7889999999999 999999999999995433 3444443332 5999999999999999999986542
Q ss_pred --------------------------EEcCCCCCceeeeccCCCCC
Q 040274 220 --------------------------LVPRSSEPNFDSWVANPFET 239 (359)
Q Consensus 220 --------------------------~~~gs~~~~~~~~~~~~~~~ 239 (359)
+.+|+.|+++++|.++|-+.
T Consensus 256 geEi~~~nkgh~gpVhcVrFSPdGE~yAsGSEDGTirlWQt~~~~~ 301 (334)
T KOG0278|consen 256 GEEIGSYNKGHFGPVHCVRFSPDGELYASGSEDGTIRLWQTTPGKT 301 (334)
T ss_pred CceeeecccCCCCceEEEEECCCCceeeccCCCceEEEEEecCCCc
Confidence 78999999999999887554
No 52
>KOG1446 consensus Histone H3 (Lys4) methyltransferase complex and RNA cleavage factor II complex, subunit SWD2 [RNA processing and modification; Chromatin structure and dynamics; Posttranslational modification, protein turnover, chaperones]
Probab=99.86 E-value=1.3e-19 Score=154.17 Aligned_cols=183 Identities=14% Similarity=0.229 Sum_probs=145.4
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeC--CCeEEEEeCCCCcceEEee
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHS--GGTVTMWKPTTSALLIKML 106 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~--dg~v~lwd~~~~~~~~~~~ 106 (359)
.+|.|+++|.+|++++. .|..++|-.....++.++. |.+|+..++.+.+.++.|.
T Consensus 18 ~sl~fs~~G~~litss~dDsl~LYd~~~g~~~~ti~skkyG~~~~~Fth~~~~~i~sStk~d~tIryLsl~dNkylRYF~ 97 (311)
T KOG1446|consen 18 NSLDFSDDGLLLITSSEDDSLRLYDSLSGKQVKTINSKKYGVDLACFTHHSNTVIHSSTKEDDTIRYLSLHDNKYLRYFP 97 (311)
T ss_pred eEEEecCCCCEEEEecCCCeEEEEEcCCCceeeEeecccccccEEEEecCCceEEEccCCCCCceEEEEeecCceEEEcC
Confidence 78999999999999776 6778888665556666665 8899999999999999999
Q ss_pred cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee-cCCceeEEEcCCC-cEEEEcCC-cEEEEcCCCCCc-cc
Q 040274 107 YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL-TGHAKTLDFSQKG-LLAVGTGS-FAQILGDFSGSH-NY 182 (359)
Q Consensus 107 ~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~-~~~v~~~~~s~~g-l~~~~~d~-~i~v~d~~~~~~-~~ 182 (359)
||...|++++.+|-+..+++++.|++|++||++..++..-+ ......++|+|.| +++.+.++ .|.+||++.-.. +.
T Consensus 98 GH~~~V~sL~~sP~~d~FlS~S~D~tvrLWDlR~~~cqg~l~~~~~pi~AfDp~GLifA~~~~~~~IkLyD~Rs~dkgPF 177 (311)
T KOG1446|consen 98 GHKKRVNSLSVSPKDDTFLSSSLDKTVRLWDLRVKKCQGLLNLSGRPIAAFDPEGLIFALANGSELIKLYDLRSFDKGPF 177 (311)
T ss_pred CCCceEEEEEecCCCCeEEecccCCeEEeeEecCCCCceEEecCCCcceeECCCCcEEEEecCCCeEEEEEecccCCCCc
Confidence 99999999999999999999999999999999987776555 2344678999999 55555554 999999876422 22
Q ss_pred cccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE---------------------------------EEcCCCCCce
Q 040274 183 SRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI---------------------------------LVPRSSEPNF 229 (359)
Q Consensus 183 ~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i---------------------------------~~~gs~~~~~ 229 (359)
..+.-... .....+.+.|||||++|+.++..+.+.+ +..|++|+.+
T Consensus 178 ~tf~i~~~-~~~ew~~l~FS~dGK~iLlsT~~s~~~~lDAf~G~~~~tfs~~~~~~~~~~~a~ftPds~Fvl~gs~dg~i 256 (311)
T KOG1446|consen 178 TTFSITDN-DEAEWTDLEFSPDGKSILLSTNASFIYLLDAFDGTVKSTFSGYPNAGNLPLSATFTPDSKFVLSGSDDGTI 256 (311)
T ss_pred eeEccCCC-CccceeeeEEcCCCCEEEEEeCCCcEEEEEccCCcEeeeEeeccCCCCcceeEEECCCCcEEEEecCCCcE
Confidence 22221111 3346899999999999999988886554 6778888999
Q ss_pred eeeccC
Q 040274 230 DSWVAN 235 (359)
Q Consensus 230 ~~~~~~ 235 (359)
.+|+++
T Consensus 257 ~vw~~~ 262 (311)
T KOG1446|consen 257 HVWNLE 262 (311)
T ss_pred EEEEcC
Confidence 999874
No 53
>KOG0277 consensus Peroxisomal targeting signal type 2 receptor [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.86 E-value=1.3e-20 Score=155.57 Aligned_cols=148 Identities=17% Similarity=0.175 Sum_probs=125.0
Q ss_pred ceeEEEEcCC-CCEEEEEeCCCeEEEEeCCC-CcceEEeecCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCCCeeeE
Q 040274 69 RTDLMRVNPF-NGVVSLGHSGGTVTMWKPTT-SALLIKMLYHQGPVSALAFHP-NGHLMATTGKECKIKIWDLRKYEVLQ 145 (359)
Q Consensus 69 ~v~~l~~sp~-~~~l~tg~~dg~v~lwd~~~-~~~~~~~~~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~~~~~~ 145 (359)
.+..++|+++ .+.+++++.||+++|||+.. ..|+..++.|...|.++.|++ ....+++++.|++|++||..-+..+.
T Consensus 62 ~LfdV~Wse~~e~~~~~a~GDGSLrl~d~~~~s~Pi~~~kEH~~EV~Svdwn~~~r~~~ltsSWD~TiKLW~~~r~~Sv~ 141 (311)
T KOG0277|consen 62 GLFDVAWSENHENQVIAASGDGSLRLFDLTMPSKPIHKFKEHKREVYSVDWNTVRRRIFLTSSWDGTIKLWDPNRPNSVQ 141 (311)
T ss_pred ceeEeeecCCCcceEEEEecCceEEEeccCCCCcchhHHHhhhhheEEeccccccceeEEeeccCCceEeecCCCCcceE
Confidence 7899999995 46888999999999999653 368899999999999999998 45568888999999999999999999
Q ss_pred eecCC---ceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCC-CEEEEEeCCCeEE
Q 040274 146 TLTGH---AKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYE-DVLGIGHSMGWSG 218 (359)
Q Consensus 146 ~~~~~---v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~-~~l~~g~~dg~~~ 218 (359)
++.++ |....|||.. +++++.|+++++||++..++... +..|.. .|.|+.|+... .+|++|+.|+.++
T Consensus 142 Tf~gh~~~Iy~a~~sp~~~nlfas~Sgd~~l~lwdvr~~gk~~~-i~ah~~----Eil~cdw~ky~~~vl~Tg~vd~~vr 216 (311)
T KOG0277|consen 142 TFNGHNSCIYQAAFSPHIPNLFASASGDGTLRLWDVRSPGKFMS-IEAHNS----EILCCDWSKYNHNVLATGGVDNLVR 216 (311)
T ss_pred eecCCccEEEEEecCCCCCCeEEEccCCceEEEEEecCCCceeE-EEeccc----eeEeecccccCCcEEEecCCCceEE
Confidence 99766 6788999976 77888999999999877755444 666644 89999999854 6788999999888
Q ss_pred EEE
Q 040274 219 ILV 221 (359)
Q Consensus 219 i~~ 221 (359)
+|.
T Consensus 217 ~wD 219 (311)
T KOG0277|consen 217 GWD 219 (311)
T ss_pred EEe
Confidence 753
No 54
>PTZ00420 coronin; Provisional
Probab=99.86 E-value=1.4e-19 Score=173.09 Aligned_cols=171 Identities=13% Similarity=0.109 Sum_probs=132.4
Q ss_pred eEEEECCC-CCEEEEecc-------------------------------ceeEEEEcCCCCE-EEEEeCCCeEEEEeCCC
Q 040274 52 ILWILPSS-GRYMAVAGR-------------------------------RTDLMRVNPFNGV-VSLGHSGGTVTMWKPTT 98 (359)
Q Consensus 52 ~~l~~spd-g~~l~~~~~-------------------------------~v~~l~~sp~~~~-l~tg~~dg~v~lwd~~~ 98 (359)
++++|+|+ +.+|++|+. .|.+++|+|++.. |++|+.|++|+|||+.+
T Consensus 78 ~~lafsP~~~~lLASgS~DgtIrIWDi~t~~~~~~~i~~p~~~L~gH~~~V~sVaf~P~g~~iLaSgS~DgtIrIWDl~t 157 (568)
T PTZ00420 78 LDLQFNPCFSEILASGSEDLTIRVWEIPHNDESVKEIKDPQCILKGHKKKISIIDWNPMNYYIMCSSGFDSFVNIWDIEN 157 (568)
T ss_pred EEEEEcCCCCCEEEEEeCCCeEEEEECCCCCccccccccceEEeecCCCcEEEEEECCCCCeEEEEEeCCCeEEEEECCC
Confidence 89999996 789998876 4789999998865 57899999999999999
Q ss_pred CcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecCC---c-----eeEEEcCCC--cEEEEcCC
Q 040274 99 SALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTGH---A-----KTLDFSQKG--LLAVGTGS 168 (359)
Q Consensus 99 ~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~~---v-----~~~~~s~~g--l~~~~~d~ 168 (359)
+..+..+. |...|.+++|+|+|.+|++++.|+.|+|||+++++.+.++.+| + ....|++++ +++++.++
T Consensus 158 g~~~~~i~-~~~~V~SlswspdG~lLat~s~D~~IrIwD~Rsg~~i~tl~gH~g~~~s~~v~~~~fs~d~~~IlTtG~d~ 236 (568)
T PTZ00420 158 EKRAFQIN-MPKKLSSLKWNIKGNLLSGTCVGKHMHIIDPRKQEIASSFHIHDGGKNTKNIWIDGLGGDDNYILSTGFSK 236 (568)
T ss_pred CcEEEEEe-cCCcEEEEEECCCCCEEEEEecCCEEEEEECCCCcEEEEEecccCCceeEEEEeeeEcCCCCEEEEEEcCC
Confidence 98777765 6678999999999999999999999999999999988888544 2 223355776 77777664
Q ss_pred ----cEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCC
Q 040274 169 ----FAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSS 225 (359)
Q Consensus 169 ----~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~ 225 (359)
.|.|||+......+..+..+. ....+......++|.++++|+.|+.+++|....+
T Consensus 237 ~~~R~VkLWDlr~~~~pl~~~~ld~--~~~~L~p~~D~~tg~l~lsGkGD~tIr~~e~~~~ 295 (568)
T PTZ00420 237 NNMREMKLWDLKNTTSALVTMSIDN--ASAPLIPHYDESTGLIYLIGKGDGNCRYYQHSLG 295 (568)
T ss_pred CCccEEEEEECCCCCCceEEEEecC--CccceEEeeeCCCCCEEEEEECCCeEEEEEccCC
Confidence 799999876544444332221 2223444444566899999999999999976443
No 55
>KOG0292 consensus Vesicle coat complex COPI, alpha subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.85 E-value=6.7e-21 Score=180.57 Aligned_cols=146 Identities=23% Similarity=0.376 Sum_probs=135.4
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
.|-.++|||.-.+|+++..+|.|++||.+.+.++..|..|.++|.+++|+|++.+|++||.|-.|+||+..+.+++.++.
T Consensus 11 RvKglsFHP~rPwILtslHsG~IQlWDYRM~tli~rFdeHdGpVRgv~FH~~qplFVSGGDDykIkVWnYk~rrclftL~ 90 (1202)
T KOG0292|consen 11 RVKGLSFHPKRPWILTSLHSGVIQLWDYRMGTLIDRFDEHDGPVRGVDFHPTQPLFVSGGDDYKIKVWNYKTRRCLFTLL 90 (1202)
T ss_pred cccceecCCCCCEEEEeecCceeeeehhhhhhHHhhhhccCCccceeeecCCCCeEEecCCccEEEEEecccceehhhhc
Confidence 57889999999999999999999999999999999999999999999999999999999999999999999999999996
Q ss_pred CC---ceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 149 GH---AKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 149 ~~---v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
|| |..+.|++.- ++++|.|.+|+||+..+. ..+..+.+|.. -|+|..|+|..+.++++|-|-++++
T Consensus 91 GHlDYVRt~~FHheyPWIlSASDDQTIrIWNwqsr-~~iavltGHnH----YVMcAqFhptEDlIVSaSLDQTVRV 161 (1202)
T KOG0292|consen 91 GHLDYVRTVFFHHEYPWILSASDDQTIRIWNWQSR-KCIAVLTGHNH----YVMCAQFHPTEDLIVSASLDQTVRV 161 (1202)
T ss_pred cccceeEEeeccCCCceEEEccCCCeEEEEeccCC-ceEEEEecCce----EEEeeccCCccceEEEecccceEEE
Confidence 66 7899999988 889999999999996544 77778888865 7999999999999999999999887
No 56
>KOG0276 consensus Vesicle coat complex COPI, beta' subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.85 E-value=1.7e-20 Score=171.95 Aligned_cols=163 Identities=13% Similarity=0.158 Sum_probs=143.2
Q ss_pred eEEEECCCCCEEEEecc------------------------ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCCcceEEee
Q 040274 52 ILWILPSSGRYMAVAGR------------------------RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTSALLIKML 106 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~~~~~~~ 106 (359)
.+++.||.-.+++++++ -|.+++|+| |.+.++++|-|++|.||.+.+..+..++.
T Consensus 101 R~iavHPt~P~vLtsSDDm~iKlW~we~~wa~~qtfeGH~HyVMqv~fnPkD~ntFaS~sLDrTVKVWslgs~~~nfTl~ 180 (794)
T KOG0276|consen 101 RSIAVHPTLPYVLTSSDDMTIKLWDWENEWACEQTFEGHEHYVMQVAFNPKDPNTFASASLDRTVKVWSLGSPHPNFTLE 180 (794)
T ss_pred eeeeecCCCCeEEecCCccEEEEeeccCceeeeeEEcCcceEEEEEEecCCCccceeeeeccccEEEEEcCCCCCceeee
Confidence 89999999999999998 799999999 88899999999999999999999999999
Q ss_pred cCCCCeEEEEEecC--CCEEEEecCCCeEEEEEcCCCeeeEeecCC---ceeEEEcCCC--cEEEEcCCcEEEEcCCCCC
Q 040274 107 YHQGPVSALAFHPN--GHLMATTGKECKIKIWDLRKYEVLQTLTGH---AKTLDFSQKG--LLAVGTGSFAQILGDFSGS 179 (359)
Q Consensus 107 ~h~~~v~~l~~~p~--g~~l~s~~~d~~i~vwd~~~~~~~~~~~~~---v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~ 179 (359)
+|...|+|+.|-+. -.+|+||+.|.+|+|||..+..|++++.|| |+.++|+|.- +++|+.||+++||+. ...
T Consensus 181 gHekGVN~Vdyy~~gdkpylIsgaDD~tiKvWDyQtk~CV~TLeGHt~Nvs~v~fhp~lpiiisgsEDGTvriWhs-~Ty 259 (794)
T KOG0276|consen 181 GHEKGVNCVDYYTGGDKPYLISGADDLTIKVWDYQTKSCVQTLEGHTNNVSFVFFHPELPIIISGSEDGTVRIWNS-KTY 259 (794)
T ss_pred ccccCcceEEeccCCCcceEEecCCCceEEEeecchHHHHHHhhcccccceEEEecCCCcEEEEecCCccEEEecC-cce
Confidence 99999999999874 469999999999999999999999999776 7889999998 889999999999984 333
Q ss_pred ccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 180 HNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 180 ~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
.....+.-. ..+|+|++-.+.+..+++|.+.|.+.+
T Consensus 260 ~lE~tLn~g----leRvW~I~~~k~~~~i~vG~Deg~i~v 295 (794)
T KOG0276|consen 260 KLEKTLNYG----LERVWCIAAHKGDGKIAVGFDEGSVTV 295 (794)
T ss_pred ehhhhhhcC----CceEEEEeecCCCCeEEEeccCCcEEE
Confidence 333333222 237999999999999999999997765
No 57
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=99.85 E-value=3.1e-19 Score=157.75 Aligned_cols=168 Identities=20% Similarity=0.337 Sum_probs=143.8
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h 108 (359)
.+++|+|++++|++++. .+.++.|+|++.+|++++.||.|.+|++.++..+..+..|
T Consensus 13 ~~~~~~~~~~~l~~~~~~g~i~i~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~l~~~~~~~~i~i~~~~~~~~~~~~~~~ 92 (289)
T cd00200 13 TCVAFSPDGKLLATGSGDGTIKVWDLETGELLRTLKGHTGPVRDVAASADGTYLASGSSDKTIRLWDLETGECVRTLTGH 92 (289)
T ss_pred EEEEEcCCCCEEEEeecCcEEEEEEeeCCCcEEEEecCCcceeEEEECCCCCEEEEEcCCCeEEEEEcCcccceEEEecc
Confidence 89999999999999884 6779999999999999999999999999988888888899
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec---CCceeEEEcCCC-cEEEEc-CCcEEEEcCCCCCcccc
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT---GHAKTLDFSQKG-LLAVGT-GSFAQILGDFSGSHNYS 183 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~---~~v~~~~~s~~g-l~~~~~-d~~i~v~d~~~~~~~~~ 183 (359)
...+.++.|+|++.++++++.|+.|.+||+.+++.+..+. ..+.+++|+|++ +++++. ++.|.+||+... ....
T Consensus 93 ~~~i~~~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~l~~~~~~~~i~i~d~~~~-~~~~ 171 (289)
T cd00200 93 TSYVSSVAFSPDGRILSSSSRDKTIKVWDVETGKCLTTLRGHTDWVNSVAFSPDGTFVASSSQDGTIKLWDLRTG-KCVA 171 (289)
T ss_pred CCcEEEEEEcCCCCEEEEecCCCeEEEEECCCcEEEEEeccCCCcEEEEEEcCcCCEEEEEcCCCcEEEEEcccc-ccce
Confidence 9999999999999899998889999999999888777773 458999999988 666555 999999997543 4444
Q ss_pred ccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCC
Q 040274 184 RYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRS 224 (359)
Q Consensus 184 ~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs 224 (359)
.+..|. ..|.++.|+|++..|++++.+|.+.+|....
T Consensus 172 ~~~~~~----~~i~~~~~~~~~~~l~~~~~~~~i~i~d~~~ 208 (289)
T cd00200 172 TLTGHT----GEVNSVAFSPDGEKLLSSSSDGTIKLWDLST 208 (289)
T ss_pred eEecCc----cccceEEECCCcCEEEEecCCCcEEEEECCC
Confidence 444443 3799999999999999999899888877654
No 58
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=99.85 E-value=7.2e-20 Score=158.19 Aligned_cols=159 Identities=18% Similarity=0.181 Sum_probs=143.1
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
+|.+++.+|++++++||+.|..-++|++.++..+..+.+|...|+++.|+.+|.+||||+.+|.|.||+..++.....+.
T Consensus 66 svFavsl~P~~~l~aTGGgDD~AflW~~~~ge~~~eltgHKDSVt~~~FshdgtlLATGdmsG~v~v~~~stg~~~~~~~ 145 (399)
T KOG0296|consen 66 SVFAVSLHPNNNLVATGGGDDLAFLWDISTGEFAGELTGHKDSVTCCSFSHDGTLLATGDMSGKVLVFKVSTGGEQWKLD 145 (399)
T ss_pred ceEEEEeCCCCceEEecCCCceEEEEEccCCcceeEecCCCCceEEEEEccCceEEEecCCCccEEEEEcccCceEEEee
Confidence 79999999999999999999999999999999999999999999999999999999999999999999999998888774
Q ss_pred ---CCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 149 ---GHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 149 ---~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
..+.-+.|+|.+ +++++.||.+.+|.+... .....+.+|.. ++++-.|.|+|..+++|..||++.+|.+.
T Consensus 146 ~e~~dieWl~WHp~a~illAG~~DGsvWmw~ip~~-~~~kv~~Gh~~----~ct~G~f~pdGKr~~tgy~dgti~~Wn~k 220 (399)
T KOG0296|consen 146 QEVEDIEWLKWHPRAHILLAGSTDGSVWMWQIPSQ-ALCKVMSGHNS----PCTCGEFIPDGKRILTGYDDGTIIVWNPK 220 (399)
T ss_pred cccCceEEEEecccccEEEeecCCCcEEEEECCCc-ceeeEecCCCC----CcccccccCCCceEEEEecCceEEEEecC
Confidence 346778899998 888889999999996554 55666777654 89999999999999999999999999999
Q ss_pred CCCCceeee
Q 040274 224 SSEPNFDSW 232 (359)
Q Consensus 224 s~~~~~~~~ 232 (359)
++.+-+++-
T Consensus 221 tg~p~~~~~ 229 (399)
T KOG0296|consen 221 TGQPLHKIT 229 (399)
T ss_pred CCceeEEec
Confidence 987776665
No 59
>KOG0269 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.85 E-value=9.8e-21 Score=177.28 Aligned_cols=151 Identities=14% Similarity=0.270 Sum_probs=130.9
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCC---CcceEEeecCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCCCee
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTT---SALLIKMLYHQGPVSALAFHP-NGHLMATTGKECKIKIWDLRKYEV 143 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~---~~~~~~~~~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~~~~ 143 (359)
.+..+.|+. +.++|+|++.+|.|.+||+.. ...+..|..|...+++++|++ ..++|++||.||+|++||++....
T Consensus 89 S~~DVkW~~~~~NlIAT~s~nG~i~vWdlnk~~rnk~l~~f~EH~Rs~~~ldfh~tep~iliSGSQDg~vK~~DlR~~~S 168 (839)
T KOG0269|consen 89 SAADVKWGQLYSNLIATCSTNGVISVWDLNKSIRNKLLTVFNEHERSANKLDFHSTEPNILISGSQDGTVKCWDLRSKKS 168 (839)
T ss_pred ehhhcccccchhhhheeecCCCcEEEEecCccccchhhhHhhhhccceeeeeeccCCccEEEecCCCceEEEEeeecccc
Confidence 677888986 678999999999999999986 455667889999999999998 566899999999999999999888
Q ss_pred eEeec---CCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeE
Q 040274 144 LQTLT---GHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWS 217 (359)
Q Consensus 144 ~~~~~---~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~ 217 (359)
..++. ..|.++.|+|.- ++++...|.+++||++........+..|.+ +|.|+.|+|++.+||+|+.|+.+
T Consensus 169 ~~t~~~nSESiRDV~fsp~~~~~F~s~~dsG~lqlWDlRqp~r~~~k~~AH~G----pV~c~nwhPnr~~lATGGRDK~v 244 (839)
T KOG0269|consen 169 KSTFRSNSESIRDVKFSPGYGNKFASIHDSGYLQLWDLRQPDRCEKKLTAHNG----PVLCLNWHPNREWLATGGRDKMV 244 (839)
T ss_pred cccccccchhhhceeeccCCCceEEEecCCceEEEeeccCchhHHHHhhcccC----ceEEEeecCCCceeeecCCCccE
Confidence 77773 458999999965 666677799999999888777777777766 99999999999999999999999
Q ss_pred EEEEcC
Q 040274 218 GILVPR 223 (359)
Q Consensus 218 ~i~~~g 223 (359)
.||..+
T Consensus 245 kiWd~t 250 (839)
T KOG0269|consen 245 KIWDMT 250 (839)
T ss_pred EEEecc
Confidence 997554
No 60
>KOG0973 consensus Histone transcription regulator HIRA, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=99.85 E-value=3.4e-20 Score=179.74 Aligned_cols=175 Identities=19% Similarity=0.273 Sum_probs=145.9
Q ss_pred eEEEECCCCCEEEEecc-----------------------------------------ceeEEEEcCCCCEEEEEeCCCe
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------------------------RTDLMRVNPFNGVVSLGHSGGT 90 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------------------------~v~~l~~sp~~~~l~tg~~dg~ 90 (359)
.|+.|+|||+|||+|++ .|..++|+|++.+|++++.|++
T Consensus 73 ~CVR~S~dG~~lAsGSDD~~v~iW~~~~~~~~~~fgs~g~~~~vE~wk~~~~l~~H~~DV~Dv~Wsp~~~~lvS~s~Dns 152 (942)
T KOG0973|consen 73 NCVRFSPDGSYLASGSDDRLVMIWERAEIGSGTVFGSTGGAKNVESWKVVSILRGHDSDVLDVNWSPDDSLLVSVSLDNS 152 (942)
T ss_pred eEEEECCCCCeEeeccCcceEEEeeecccCCcccccccccccccceeeEEEEEecCCCccceeccCCCccEEEEecccce
Confidence 99999999999999998 7999999999999999999999
Q ss_pred EEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec---------CCceeEEEcCCC-
Q 040274 91 VTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT---------GHAKTLDFSQKG- 160 (359)
Q Consensus 91 v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~---------~~v~~~~~s~~g- 160 (359)
|.||+..+.+.+..+.+|.+.|-.+.|+|-|+|||+-+.|++|+||++.+....+.+. .+...+.|||||
T Consensus 153 Viiwn~~tF~~~~vl~~H~s~VKGvs~DP~Gky~ASqsdDrtikvwrt~dw~i~k~It~pf~~~~~~T~f~RlSWSPDG~ 232 (942)
T KOG0973|consen 153 VIIWNAKTFELLKVLRGHQSLVKGVSWDPIGKYFASQSDDRTLKVWRTSDWGIEKSITKPFEESPLTTFFLRLSWSPDGH 232 (942)
T ss_pred EEEEccccceeeeeeecccccccceEECCccCeeeeecCCceEEEEEcccceeeEeeccchhhCCCcceeeecccCCCcC
Confidence 9999999999999999999999999999999999999999999999988776666662 236889999999
Q ss_pred cEEEEc-----CCcEEEEcCCCCCccccccccccCCCCcceeEEEEccC-----CC------------EEEEEeCCCeEE
Q 040274 161 LLAVGT-----GSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPY-----ED------------VLGIGHSMGWSG 218 (359)
Q Consensus 161 l~~~~~-----d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-----~~------------~l~~g~~dg~~~ 218 (359)
++++.. ..++.|.+ +.+...-..+.+|.. ++.++.|+|. .. ++|+|+.|+.+.
T Consensus 233 ~las~nA~n~~~~~~~Iie-R~tWk~~~~LvGH~~----p~evvrFnP~lfe~~~~ng~~~~~~~~y~i~AvgSqDrSlS 307 (942)
T KOG0973|consen 233 HLASPNAVNGGKSTIAIIE-RGTWKVDKDLVGHSA----PVEVVRFNPKLFERNNKNGTSTQPNCYYCIAAVGSQDRSLS 307 (942)
T ss_pred eecchhhccCCcceeEEEe-cCCceeeeeeecCCC----ceEEEEeChHHhccccccCCccCCCcceEEEEEecCCccEE
Confidence 555432 24777887 555444556677754 8999999981 12 678999999999
Q ss_pred EEEcCCCCCceee
Q 040274 219 ILVPRSSEPNFDS 231 (359)
Q Consensus 219 i~~~gs~~~~~~~ 231 (359)
||.++.--|-+-+
T Consensus 308 VW~T~~~RPl~vi 320 (942)
T KOG0973|consen 308 VWNTALPRPLFVI 320 (942)
T ss_pred EEecCCCCchhhh
Confidence 9887666554433
No 61
>KOG0305 consensus Anaphase promoting complex, Cdc20, Cdh1, and Ama1 subunits [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=99.84 E-value=8.3e-20 Score=168.49 Aligned_cols=149 Identities=17% Similarity=0.231 Sum_probs=128.4
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEec-CCCEEEEec--CCCeEEEEEcCCCeeeE
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHP-NGHLMATTG--KECKIKIWDLRKYEVLQ 145 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p-~g~~l~s~~--~d~~i~vwd~~~~~~~~ 145 (359)
.|..+.|++|+.++++|+.|+.|.|||..+..++..+..|...|.+++|+| ...+||+|+ .|+.|++||..++..+.
T Consensus 303 eVCgLkws~d~~~lASGgnDN~~~Iwd~~~~~p~~~~~~H~aAVKA~awcP~q~~lLAsGGGs~D~~i~fwn~~~g~~i~ 382 (484)
T KOG0305|consen 303 EVCGLKWSPDGNQLASGGNDNVVFIWDGLSPEPKFTFTEHTAAVKALAWCPWQSGLLATGGGSADRCIKFWNTNTGARID 382 (484)
T ss_pred eeeeeEECCCCCeeccCCCccceEeccCCCccccEEEeccceeeeEeeeCCCccCceEEcCCCcccEEEEEEcCCCcEec
Confidence 799999999999999999999999999988899999999999999999999 667888876 59999999999999998
Q ss_pred ee--cCCceeEEEcCCC--cEEEE--cCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 146 TL--TGHAKTLDFSQKG--LLAVG--TGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 146 ~~--~~~v~~~~~s~~g--l~~~~--~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
.+ .+.|.++.|++.. ++++. .++.|.||+... ......+.+|.. .|..++++|||..+++|+.|.++++
T Consensus 383 ~vdtgsQVcsL~Wsk~~kEi~sthG~s~n~i~lw~~ps-~~~~~~l~gH~~----RVl~la~SPdg~~i~t~a~DETlrf 457 (484)
T KOG0305|consen 383 SVDTGSQVCSLIWSKKYKELLSTHGYSENQITLWKYPS-MKLVAELLGHTS----RVLYLALSPDGETIVTGAADETLRF 457 (484)
T ss_pred ccccCCceeeEEEcCCCCEEEEecCCCCCcEEEEeccc-cceeeeecCCcc----eeEEEEECCCCCEEEEecccCcEEe
Confidence 88 5679999999998 55443 357999999655 356667777765 8999999999999999888876666
Q ss_pred EEc
Q 040274 220 LVP 222 (359)
Q Consensus 220 ~~~ 222 (359)
|..
T Consensus 458 w~~ 460 (484)
T KOG0305|consen 458 WNL 460 (484)
T ss_pred ccc
Confidence 543
No 62
>KOG0292 consensus Vesicle coat complex COPI, alpha subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.84 E-value=6.6e-20 Score=173.94 Aligned_cols=184 Identities=13% Similarity=0.209 Sum_probs=158.1
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h 108 (359)
-.++|+|..-.++++-. +|..++|||+..+|++|+.|-.|++|+..+..++.++.+|
T Consensus 13 KglsFHP~rPwILtslHsG~IQlWDYRM~tli~rFdeHdGpVRgv~FH~~qplFVSGGDDykIkVWnYk~rrclftL~GH 92 (1202)
T KOG0292|consen 13 KGLSFHPKRPWILTSLHSGVIQLWDYRMGTLIDRFDEHDGPVRGVDFHPTQPLFVSGGDDYKIKVWNYKTRRCLFTLLGH 92 (1202)
T ss_pred cceecCCCCCEEEEeecCceeeeehhhhhhHHhhhhccCCccceeeecCCCCeEEecCCccEEEEEecccceehhhhccc
Confidence 57899999999998765 9999999999999999999999999999999999999999
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecCC---ceeEEEcCCC--cEEEEcCCcEEEEcCCCCCc---
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTGH---AKTLDFSQKG--LLAVGTGSFAQILGDFSGSH--- 180 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~~---v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~--- 180 (359)
-+.|..+.|++.-..++++|.|.+|+||+..+..++..+.|| |.|..|+|.. ++++|.|.+|+|||+..-..
T Consensus 93 lDYVRt~~FHheyPWIlSASDDQTIrIWNwqsr~~iavltGHnHYVMcAqFhptEDlIVSaSLDQTVRVWDisGLRkk~~ 172 (1202)
T KOG0292|consen 93 LDYVRTVFFHHEYPWILSASDDQTIRIWNWQSRKCIAVLTGHNHYVMCAQFHPTEDLIVSASLDQTVRVWDISGLRKKNK 172 (1202)
T ss_pred cceeEEeeccCCCceEEEccCCCeEEEEeccCCceEEEEecCceEEEeeccCCccceEEEecccceEEEEeecchhccCC
Confidence 999999999999999999999999999999999999999776 7899999966 88899999999999632100
Q ss_pred -c------------------------ccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE----------------
Q 040274 181 -N------------------------YSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI---------------- 219 (359)
Q Consensus 181 -~------------------------~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i---------------- 219 (359)
+ ...+.+| ...|+-++|+|.-.+|++|++|..+.+
T Consensus 173 ~pg~~e~~~~~~~~~~dLfg~~DaVVK~VLEGH----DRGVNwaAfhpTlpliVSG~DDRqVKlWrmnetKaWEvDtcrg 248 (1202)
T KOG0292|consen 173 APGSLEDQMRGQQGNSDLFGQTDAVVKHVLEGH----DRGVNWAAFHPTLPLIVSGADDRQVKLWRMNETKAWEVDTCRG 248 (1202)
T ss_pred CCCCchhhhhccccchhhcCCcCeeeeeeeccc----ccccceEEecCCcceEEecCCcceeeEEEeccccceeehhhhc
Confidence 0 0112233 336888999999999999999998766
Q ss_pred ----------------EEcCCCCCceeeeccCCCCC
Q 040274 220 ----------------LVPRSSEPNFDSWVANPFET 239 (359)
Q Consensus 220 ----------------~~~gs~~~~~~~~~~~~~~~ 239 (359)
+++.+.|.+|++|+++--..
T Consensus 249 H~nnVssvlfhp~q~lIlSnsEDksirVwDm~kRt~ 284 (1202)
T KOG0292|consen 249 HYNNVSSVLFHPHQDLILSNSEDKSIRVWDMTKRTS 284 (1202)
T ss_pred ccCCcceEEecCccceeEecCCCccEEEEecccccc
Confidence 56788899999999874433
No 63
>KOG0283 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.84 E-value=1.3e-20 Score=178.42 Aligned_cols=147 Identities=12% Similarity=0.186 Sum_probs=126.0
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCC--------------------------------------------------
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTT-------------------------------------------------- 98 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~-------------------------------------------------- 98 (359)
.|++|.||+||+|||+|+.||.|+||.+..
T Consensus 269 aIw~mKFS~DGKyLAsaGeD~virVWkVie~e~~~~~~~~~~~~~~~~~~~s~~~p~~s~~~~~~~~~s~~~~~~~s~~~ 348 (712)
T KOG0283|consen 269 AIWAMKFSHDGKYLASAGEDGVIRVWKVIESERMRVAEGDSSCMYFEYNANSQIEPSTSSEEKISSRTSSSRKGSQSPCV 348 (712)
T ss_pred cEEEEEeCCCCceeeecCCCceEEEEEEeccchhcccccccchhhhhhhhccccCccccccccccccccccccccCCccc
Confidence 799999999999999999999999997643
Q ss_pred ----------CcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCC---cEE
Q 040274 99 ----------SALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG---LLA 163 (359)
Q Consensus 99 ----------~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g---l~~ 163 (359)
.+|+..|.||.+.|..|+|+.++ +|++++.|.+|++|++....|+..| ...|+|++|+|-. +++
T Consensus 349 ~~p~~~f~f~ekP~~ef~GHt~DILDlSWSKn~-fLLSSSMDKTVRLWh~~~~~CL~~F~HndfVTcVaFnPvDDryFiS 427 (712)
T KOG0283|consen 349 LLPLKAFVFSEKPFCEFKGHTADILDLSWSKNN-FLLSSSMDKTVRLWHPGRKECLKVFSHNDFVTCVAFNPVDDRYFIS 427 (712)
T ss_pred cCCCccccccccchhhhhccchhheecccccCC-eeEeccccccEEeecCCCcceeeEEecCCeeEEEEecccCCCcEee
Confidence 01455677999999999999875 8899999999999999999999988 6789999999965 899
Q ss_pred EEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEc
Q 040274 164 VGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVP 222 (359)
Q Consensus 164 ~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~ 222 (359)
|+-|+.|+||++... +...-+..+. .|++++|+|||.+.++|+.+|..++|.+
T Consensus 428 GSLD~KvRiWsI~d~-~Vv~W~Dl~~-----lITAvcy~PdGk~avIGt~~G~C~fY~t 480 (712)
T KOG0283|consen 428 GSLDGKVRLWSISDK-KVVDWNDLRD-----LITAVCYSPDGKGAVIGTFNGYCRFYDT 480 (712)
T ss_pred cccccceEEeecCcC-eeEeehhhhh-----hheeEEeccCCceEEEEEeccEEEEEEc
Confidence 999999999996543 4444444443 6999999999999999999999888544
No 64
>KOG0295 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.84 E-value=1.1e-19 Score=156.91 Aligned_cols=164 Identities=18% Similarity=0.288 Sum_probs=143.2
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h 108 (359)
.++.|-|.|.+|+++++ .|..++.+.||.++++++.|.+|++|-+.++++...+..|
T Consensus 197 S~V~f~P~gd~ilS~srD~tik~We~~tg~cv~t~~~h~ewvr~v~v~~DGti~As~s~dqtl~vW~~~t~~~k~~lR~h 276 (406)
T KOG0295|consen 197 SSVFFLPLGDHILSCSRDNTIKAWECDTGYCVKTFPGHSEWVRMVRVNQDGTIIASCSNDQTLRVWVVATKQCKAELREH 276 (406)
T ss_pred eeEEEEecCCeeeecccccceeEEecccceeEEeccCchHhEEEEEecCCeeEEEecCCCceEEEEEeccchhhhhhhcc
Confidence 88899999999999998 6889999999999999999999999999999999999999
Q ss_pred CCCeEEEEEecC----------C-----CEEEEecCCCeEEEEEcCCCeeeEeecCC---ceeEEEcCCC--cEEEEcCC
Q 040274 109 QGPVSALAFHPN----------G-----HLMATTGKECKIKIWDLRKYEVLQTLTGH---AKTLDFSQKG--LLAVGTGS 168 (359)
Q Consensus 109 ~~~v~~l~~~p~----------g-----~~l~s~~~d~~i~vwd~~~~~~~~~~~~~---v~~~~~s~~g--l~~~~~d~ 168 (359)
..+|-+++|-|. | .++++++.|++|++||+.++.++.++.++ |..++|+|.| ++++..|+
T Consensus 277 Eh~vEci~wap~~~~~~i~~at~~~~~~~~l~s~SrDktIk~wdv~tg~cL~tL~ghdnwVr~~af~p~Gkyi~ScaDDk 356 (406)
T KOG0295|consen 277 EHPVECIAWAPESSYPSISEATGSTNGGQVLGSGSRDKTIKIWDVSTGMCLFTLVGHDNWVRGVAFSPGGKYILSCADDK 356 (406)
T ss_pred ccceEEEEecccccCcchhhccCCCCCccEEEeecccceEEEEeccCCeEEEEEecccceeeeeEEcCCCeEEEEEecCC
Confidence 999999999872 2 48999999999999999999999999554 8999999999 78888999
Q ss_pred cEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEE
Q 040274 169 FAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGIL 220 (359)
Q Consensus 169 ~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~ 220 (359)
++++||+.+. .....+..|.. -|+++.|+.+-.++++|+-|-.+.+|
T Consensus 357 tlrvwdl~~~-~cmk~~~ah~h----fvt~lDfh~~~p~VvTGsVdqt~Kvw 403 (406)
T KOG0295|consen 357 TLRVWDLKNL-QCMKTLEAHEH----FVTSLDFHKTAPYVVTGSVDQTVKVW 403 (406)
T ss_pred cEEEEEeccc-eeeeccCCCcc----eeEEEecCCCCceEEeccccceeeee
Confidence 9999997554 45555556644 79999999999988888777655554
No 65
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=99.84 E-value=7.4e-20 Score=161.28 Aligned_cols=166 Identities=23% Similarity=0.325 Sum_probs=135.2
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML 106 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~ 106 (359)
..+..+|.|.||++++. .+++.+|||||.+|.+|..||.|.|||+.++..+..|.
T Consensus 307 ~~ls~h~tgeYllsAs~d~~w~Fsd~~~g~~lt~vs~~~s~v~~ts~~fHpDgLifgtgt~d~~vkiwdlks~~~~a~Fp 386 (506)
T KOG0289|consen 307 TGLSLHPTGEYLLSASNDGTWAFSDISSGSQLTVVSDETSDVEYTSAAFHPDGLIFGTGTPDGVVKIWDLKSQTNVAKFP 386 (506)
T ss_pred eeeeeccCCcEEEEecCCceEEEEEccCCcEEEEEeeccccceeEEeeEcCCceEEeccCCCceEEEEEcCCccccccCC
Confidence 67788899999998876 48999999999999999999999999999999999999
Q ss_pred cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee--c--CCceeEEEcCCC--cEEEEcCCcEEEEcCCCC-C
Q 040274 107 YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL--T--GHAKTLDFSQKG--LLAVGTGSFAQILGDFSG-S 179 (359)
Q Consensus 107 ~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~--~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~-~ 179 (359)
+|+++|.+++|+.+|-+|++++.|+.|++||+|..+...++ . ..+.+++|.+.| +.+++.+=.|++++-.+. -
T Consensus 387 ght~~vk~i~FsENGY~Lat~add~~V~lwDLRKl~n~kt~~l~~~~~v~s~~fD~SGt~L~~~g~~l~Vy~~~k~~k~W 466 (506)
T KOG0289|consen 387 GHTGPVKAISFSENGYWLATAADDGSVKLWDLRKLKNFKTIQLDEKKEVNSLSFDQSGTYLGIAGSDLQVYICKKKTKSW 466 (506)
T ss_pred CCCCceeEEEeccCceEEEEEecCCeEEEEEehhhcccceeeccccccceeEEEcCCCCeEEeecceeEEEEEecccccc
Confidence 99999999999999999999999999999999998877777 2 258999999999 445544445555542111 1
Q ss_pred ccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 180 HNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 180 ~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
.....+..|. +..+++.|.....+|++++.|.+.+++.
T Consensus 467 ~~~~~~~~~s----g~st~v~Fg~~aq~l~s~smd~~l~~~a 504 (506)
T KOG0289|consen 467 TEIKELADHS----GLSTGVRFGEHAQYLASTSMDAILRLYA 504 (506)
T ss_pred eeeehhhhcc----cccceeeecccceEEeeccchhheEEee
Confidence 1222333343 3789999999999999999998766653
No 66
>KOG0646 consensus WD40 repeat protein [General function prediction only]
Probab=99.84 E-value=1.9e-19 Score=160.13 Aligned_cols=172 Identities=16% Similarity=0.140 Sum_probs=145.4
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCC---------CC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPT---------TS 99 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~---------~~ 99 (359)
.+++-+|+|.+|+.|+- .|+|+.|+-|+.+|+||+.||.|.+|++. +-
T Consensus 85 ~al~s~n~G~~l~ag~i~g~lYlWelssG~LL~v~~aHYQ~ITcL~fs~dgs~iiTgskDg~V~vW~l~~lv~a~~~~~~ 164 (476)
T KOG0646|consen 85 HALASSNLGYFLLAGTISGNLYLWELSSGILLNVLSAHYQSITCLKFSDDGSHIITGSKDGAVLVWLLTDLVSADNDHSV 164 (476)
T ss_pred eeeecCCCceEEEeecccCcEEEEEeccccHHHHHHhhccceeEEEEeCCCcEEEecCCCccEEEEEEEeecccccCCCc
Confidence 89999999999998843 89999999999999999999999999853 34
Q ss_pred cceEEeecCCCCeEEEEEecCC--CEEEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCC--cEEEEcCCcEEEE
Q 040274 100 ALLIKMLYHQGPVSALAFHPNG--HLMATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG--LLAVGTGSFAQIL 173 (359)
Q Consensus 100 ~~~~~~~~h~~~v~~l~~~p~g--~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g--l~~~~~d~~i~v~ 173 (359)
.++..|..|+-+|+++...+.| .+++|+|.|.++++||+..+..+.++ +..+.+++.+|.+ +++|+.+|.|.+.
T Consensus 165 ~p~~~f~~HtlsITDl~ig~Gg~~~rl~TaS~D~t~k~wdlS~g~LLlti~fp~si~av~lDpae~~~yiGt~~G~I~~~ 244 (476)
T KOG0646|consen 165 KPLHIFSDHTLSITDLQIGSGGTNARLYTASEDRTIKLWDLSLGVLLLTITFPSSIKAVALDPAERVVYIGTEEGKIFQN 244 (476)
T ss_pred cceeeeccCcceeEEEEecCCCccceEEEecCCceEEEEEeccceeeEEEecCCcceeEEEcccccEEEecCCcceEEee
Confidence 6788999999999999987753 47999999999999999999988877 6778999999998 8888899999988
Q ss_pred cCCCCC---------------ccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCC
Q 040274 174 GDFSGS---------------HNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSS 225 (359)
Q Consensus 174 d~~~~~---------------~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~ 225 (359)
++.... .....+.+|. .+..|+|++++-||..|++|+.||.+.||...|.
T Consensus 245 ~~~~~~~~~~~v~~k~~~~~~t~~~~~~Gh~--~~~~ITcLais~DgtlLlSGd~dg~VcvWdi~S~ 309 (476)
T KOG0646|consen 245 LLFKLSGQSAGVNQKGRHEENTQINVLVGHE--NESAITCLAISTDGTLLLSGDEDGKVCVWDIYSK 309 (476)
T ss_pred ehhcCCcccccccccccccccceeeeecccc--CCcceeEEEEecCccEEEeeCCCCCEEEEecchH
Confidence 764432 1112233443 2348999999999999999999999999987765
No 67
>KOG0265 consensus U5 snRNP-specific protein-like factor and related proteins [RNA processing and modification]
Probab=99.84 E-value=1.2e-19 Score=153.16 Aligned_cols=146 Identities=15% Similarity=0.300 Sum_probs=127.0
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCC----eee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKY----EVL 144 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~----~~~ 144 (359)
.++++.|+.++..+.+|+-|+.|.+||++.+..+..+.+|.++|+.+..+|+|.++.+-+.|.++++||++.. .++
T Consensus 176 qltAv~f~d~s~qv~sggIdn~ikvWd~r~~d~~~~lsGh~DtIt~lsls~~gs~llsnsMd~tvrvwd~rp~~p~~R~v 255 (338)
T KOG0265|consen 176 QLTAVGFKDTSDQVISGGIDNDIKVWDLRKNDGLYTLSGHADTITGLSLSRYGSFLLSNSMDNTVRVWDVRPFAPSQRCV 255 (338)
T ss_pred eEEEEEecccccceeeccccCceeeeccccCcceEEeecccCceeeEEeccCCCccccccccceEEEEEecccCCCCceE
Confidence 7889999999999999999999999999999999999999999999999999999999999999999999864 346
Q ss_pred EeecCC-------ceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 145 QTLTGH-------AKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 145 ~~~~~~-------v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
..+.++ ...++|+|++ +-+++.|..+++||. .....+..+++|.+ .|.++.|+|...+|++++.|.
T Consensus 256 ~if~g~~hnfeknlL~cswsp~~~~i~ags~dr~vyvwd~-~~r~~lyklpGh~g----svn~~~Fhp~e~iils~~sdk 330 (338)
T KOG0265|consen 256 KIFQGHIHNFEKNLLKCSWSPNGTKITAGSADRFVYVWDT-TSRRILYKLPGHYG----SVNEVDFHPTEPIILSCSSDK 330 (338)
T ss_pred EEeecchhhhhhhcceeeccCCCCccccccccceEEEeec-ccccEEEEcCCcce----eEEEeeecCCCcEEEEeccCc
Confidence 666544 4678999999 667778999999994 44466777888866 899999999999999999998
Q ss_pred eEEE
Q 040274 216 WSGI 219 (359)
Q Consensus 216 ~~~i 219 (359)
.+.+
T Consensus 331 ~i~l 334 (338)
T KOG0265|consen 331 TIYL 334 (338)
T ss_pred eeEe
Confidence 6543
No 68
>KOG0268 consensus Sof1-like rRNA processing protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.84 E-value=8.7e-21 Score=163.70 Aligned_cols=153 Identities=15% Similarity=0.251 Sum_probs=131.0
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCC-eeeEe
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKY-EVLQT 146 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~-~~~~~ 146 (359)
.|.++.|+| ...+|++|..|++|.|||++++.++..+.. ...-+.++|+|.+-.|++|+.|..++.||++.. .++..
T Consensus 189 ti~svkfNpvETsILas~~sDrsIvLyD~R~~~Pl~KVi~-~mRTN~IswnPeafnF~~a~ED~nlY~~DmR~l~~p~~v 267 (433)
T KOG0268|consen 189 SISSVKFNPVETSILASCASDRSIVLYDLRQASPLKKVIL-TMRTNTICWNPEAFNFVAANEDHNLYTYDMRNLSRPLNV 267 (433)
T ss_pred ceeEEecCCCcchheeeeccCCceEEEecccCCccceeee-eccccceecCccccceeeccccccceehhhhhhcccchh
Confidence 789999999 566888888999999999999999887643 555688999998888999999999999999975 46777
Q ss_pred ecCC---ceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 147 LTGH---AKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 147 ~~~~---v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
+.+| |.+++|||.| ++++|.|.+|+||.+.. +.....|.+..+ +.|.|+.||.|.+|+++||+|+.+++|-
T Consensus 268 ~~dhvsAV~dVdfsptG~EfvsgsyDksIRIf~~~~-~~SRdiYhtkRM---q~V~~Vk~S~Dskyi~SGSdd~nvRlWk 343 (433)
T KOG0268|consen 268 HKDHVSAVMDVDFSPTGQEFVSGSYDKSIRIFPVNH-GHSRDIYHTKRM---QHVFCVKYSMDSKYIISGSDDGNVRLWK 343 (433)
T ss_pred hcccceeEEEeccCCCcchhccccccceEEEeecCC-CcchhhhhHhhh---heeeEEEEeccccEEEecCCCcceeeee
Confidence 7665 5889999999 99999999999999544 466677766644 4699999999999999999999999998
Q ss_pred cCCCC
Q 040274 222 PRSSE 226 (359)
Q Consensus 222 ~gs~~ 226 (359)
.-+.+
T Consensus 344 a~Ase 348 (433)
T KOG0268|consen 344 AKASE 348 (433)
T ss_pred cchhh
Confidence 76554
No 69
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=99.84 E-value=3.5e-19 Score=157.35 Aligned_cols=164 Identities=23% Similarity=0.401 Sum_probs=141.0
Q ss_pred eEEEECCCCCEEEEec-c----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecC
Q 040274 52 ILWILPSSGRYMAVAG-R----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~-~----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h 108 (359)
.++.|+|++.++++++ . .+.++.|+|++.++++++.||.|.+||+.+++.+..+..|
T Consensus 97 ~~~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~l~~~~~~~~i~i~d~~~~~~~~~~~~~ 176 (289)
T cd00200 97 SSVAFSPDGRILSSSSRDKTIKVWDVETGKCLTTLRGHTDWVNSVAFSPDGTFVASSSQDGTIKLWDLRTGKCVATLTGH 176 (289)
T ss_pred EEEEEcCCCCEEEEecCCCeEEEEECCCcEEEEEeccCCCcEEEEEEcCcCCEEEEEcCCCcEEEEEccccccceeEecC
Confidence 7899999999998887 3 5899999999999999988999999999999989899999
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee---cCCceeEEEcCCC-cEEEEc-CCcEEEEcCCCCCcccc
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL---TGHAKTLDFSQKG-LLAVGT-GSFAQILGDFSGSHNYS 183 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~---~~~v~~~~~s~~g-l~~~~~-d~~i~v~d~~~~~~~~~ 183 (359)
...+.++.|+|++..+++++.|+.|.+||++.+..+..+ ...+.++.|+|++ +++++. ++.|.+||+... ....
T Consensus 177 ~~~i~~~~~~~~~~~l~~~~~~~~i~i~d~~~~~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~~~~i~i~~~~~~-~~~~ 255 (289)
T cd00200 177 TGEVNSVAFSPDGEKLLSSSSDGTIKLWDLSTGKCLGTLRGHENGVNSVAFSPDGYLLASGSEDGTIRVWDLRTG-ECVQ 255 (289)
T ss_pred ccccceEEECCCcCEEEEecCCCcEEEEECCCCceecchhhcCCceEEEEEcCCCcEEEEEcCCCcEEEEEcCCc-eeEE
Confidence 999999999999999999999999999999988887776 3468999999998 555554 999999996543 4444
Q ss_pred ccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEE
Q 040274 184 RYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGIL 220 (359)
Q Consensus 184 ~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~ 220 (359)
.+..|. ..|.+++|+|++.+|++++.||.+.+|
T Consensus 256 ~~~~~~----~~i~~~~~~~~~~~l~~~~~d~~i~iw 288 (289)
T cd00200 256 TLSGHT----NSVTSLAWSPDGKRLASGSADGTIRIW 288 (289)
T ss_pred EccccC----CcEEEEEECCCCCEEEEecCCCeEEec
Confidence 455443 379999999999999999999987776
No 70
>PLN00181 protein SPA1-RELATED; Provisional
Probab=99.84 E-value=4.6e-19 Score=180.18 Aligned_cols=169 Identities=14% Similarity=0.149 Sum_probs=138.2
Q ss_pred eEEEECC-CCCEEEEecc-----------------------ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCCcceEEee
Q 040274 52 ILWILPS-SGRYMAVAGR-----------------------RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTSALLIKML 106 (359)
Q Consensus 52 ~~l~~sp-dg~~l~~~~~-----------------------~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~~~~~~~ 106 (359)
.+++|+| ++.+|++++. .|++++|+| ++.+|++|+.||+|++||+.++..+..+.
T Consensus 536 ~~l~~~~~~~~~las~~~Dg~v~lWd~~~~~~~~~~~~H~~~V~~l~~~p~~~~~L~Sgs~Dg~v~iWd~~~~~~~~~~~ 615 (793)
T PLN00181 536 SGICWNSYIKSQVASSNFEGVVQVWDVARSQLVTEMKEHEKRVWSIDYSSADPTLLASGSDDGSVKLWSINQGVSIGTIK 615 (793)
T ss_pred eeEEeccCCCCEEEEEeCCCeEEEEECCCCeEEEEecCCCCCEEEEEEcCCCCCEEEEEcCCCEEEEEECCCCcEEEEEe
Confidence 5778876 5788888875 699999997 78899999999999999999998888886
Q ss_pred cCCCCeEEEEEe-cCCCEEEEecCCCeEEEEEcCCCe-eeEee---cCCceeEEEcCCC-cEEEEcCCcEEEEcCCCCC-
Q 040274 107 YHQGPVSALAFH-PNGHLMATTGKECKIKIWDLRKYE-VLQTL---TGHAKTLDFSQKG-LLAVGTGSFAQILGDFSGS- 179 (359)
Q Consensus 107 ~h~~~v~~l~~~-p~g~~l~s~~~d~~i~vwd~~~~~-~~~~~---~~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~- 179 (359)
.+ ..|.++.|+ ++|.+|++|+.||.|++||+++.. ++..+ ...|+++.|.+.. +++++.|++|++||+....
T Consensus 616 ~~-~~v~~v~~~~~~g~~latgs~dg~I~iwD~~~~~~~~~~~~~h~~~V~~v~f~~~~~lvs~s~D~~ikiWd~~~~~~ 694 (793)
T PLN00181 616 TK-ANICCVQFPSESGRSLAFGSADHKVYYYDLRNPKLPLCTMIGHSKTVSYVRFVDSSTLVSSSTDNTLKLWDLSMSIS 694 (793)
T ss_pred cC-CCeEEEEEeCCCCCEEEEEeCCCeEEEEECCCCCccceEecCCCCCEEEEEEeCCCEEEEEECCCEEEEEeCCCCcc
Confidence 54 679999995 579999999999999999998765 45555 3468999998555 8899999999999975421
Q ss_pred ----ccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCC
Q 040274 180 ----HNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSS 225 (359)
Q Consensus 180 ----~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~ 225 (359)
..+..+.+|. ..+.+++|+|++.+|++|+.||.+.+|.....
T Consensus 695 ~~~~~~l~~~~gh~----~~i~~v~~s~~~~~lasgs~D~~v~iw~~~~~ 740 (793)
T PLN00181 695 GINETPLHSFMGHT----NVKNFVGLSVSDGYIATGSETNEVFVYHKAFP 740 (793)
T ss_pred ccCCcceEEEcCCC----CCeeEEEEcCCCCEEEEEeCCCEEEEEECCCC
Confidence 2334455553 37899999999999999999999999986543
No 71
>KOG0973 consensus Histone transcription regulator HIRA, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=99.84 E-value=7.6e-20 Score=177.39 Aligned_cols=159 Identities=15% Similarity=0.250 Sum_probs=131.3
Q ss_pred eEEEECCCCCEEEEecc-------------------------------------ceeEEEEcCCCCEEEEEeCCCeEEEE
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------------------RTDLMRVNPFNGVVSLGHSGGTVTMW 94 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------------------~v~~l~~sp~~~~l~tg~~dg~v~lw 94 (359)
|++++||||..+++||. .|+|+.|+|||.+||+|+.|+.|.||
T Consensus 17 fSIdv~pdg~~~aTgGq~~d~~~~iW~~~~vl~~~~~~~~~l~k~l~~m~~h~~sv~CVR~S~dG~~lAsGSDD~~v~iW 96 (942)
T KOG0973|consen 17 FSIDVHPDGVKFATGGQVLDGGIVIWSQDPVLDEKEEKNENLPKHLCTMDDHDGSVNCVRFSPDGSYLASGSDDRLVMIW 96 (942)
T ss_pred EEEEecCCceeEecCCccccccceeeccccccchhhhhhcccchhheeeccccCceeEEEECCCCCeEeeccCcceEEEe
Confidence 89999999999999993 89999999999999999999999999
Q ss_pred eCCC------------------CcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecC---Ccee
Q 040274 95 KPTT------------------SALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTG---HAKT 153 (359)
Q Consensus 95 d~~~------------------~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~---~v~~ 153 (359)
.... .++...+.+|.+.|..++|+|++.+|++++.|++|.+||..+++.+..+.+ .|-.
T Consensus 97 ~~~~~~~~~~fgs~g~~~~vE~wk~~~~l~~H~~DV~Dv~Wsp~~~~lvS~s~DnsViiwn~~tF~~~~vl~~H~s~VKG 176 (942)
T KOG0973|consen 97 ERAEIGSGTVFGSTGGAKNVESWKVVSILRGHDSDVLDVNWSPDDSLLVSVSLDNSVIIWNAKTFELLKVLRGHQSLVKG 176 (942)
T ss_pred eecccCCcccccccccccccceeeEEEEEecCCCccceeccCCCccEEEEecccceEEEEccccceeeeeeecccccccc
Confidence 8762 125677889999999999999999999999999999999999988888854 5899
Q ss_pred EEEcCCC--cEEEEcCCcEEEEcCCCCCccccccc---cccCCCCcceeEEEEccCCCEEEEEe
Q 040274 154 LDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYM---GNSMVKGYQIGKVSFRPYEDVLGIGH 212 (359)
Q Consensus 154 ~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~---~~~~~~~~~v~~~~~sp~~~~l~~g~ 212 (359)
+.|.|-| +.+-+.|++|.||.+..- .....+. .+.. .......+.|||||.+|++..
T Consensus 177 vs~DP~Gky~ASqsdDrtikvwrt~dw-~i~k~It~pf~~~~-~~T~f~RlSWSPDG~~las~n 238 (942)
T KOG0973|consen 177 VSWDPIGKYFASQSDDRTLKVWRTSDW-GIEKSITKPFEESP-LTTFFLRLSWSPDGHHLASPN 238 (942)
T ss_pred eEECCccCeeeeecCCceEEEEEcccc-eeeEeeccchhhCC-CcceeeecccCCCcCeecchh
Confidence 9999999 666778899999995431 1111111 1111 233588999999999999654
No 72
>KOG0639 consensus Transducin-like enhancer of split protein (contains WD40 repeats) [Chromatin structure and dynamics]
Probab=99.83 E-value=3e-20 Score=166.43 Aligned_cols=165 Identities=19% Similarity=0.244 Sum_probs=140.4
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML 106 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~ 106 (359)
.++.++|||+.|++||. .|.+++.|||.++.++++.||.|.|||+.+...+..|.
T Consensus 469 RSckL~pdgrtLivGGeastlsiWDLAapTprikaeltssapaCyALa~spDakvcFsccsdGnI~vwDLhnq~~Vrqfq 548 (705)
T KOG0639|consen 469 RSCKLLPDGRTLIVGGEASTLSIWDLAAPTPRIKAELTSSAPACYALAISPDAKVCFSCCSDGNIAVWDLHNQTLVRQFQ 548 (705)
T ss_pred eeeEecCCCceEEeccccceeeeeeccCCCcchhhhcCCcchhhhhhhcCCccceeeeeccCCcEEEEEcccceeeeccc
Confidence 67788999999999998 68889999999999999999999999999999999999
Q ss_pred cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCC-cEEEEc-CCcEEEEcCCCCCccc
Q 040274 107 YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG-LLAVGT-GSFAQILGDFSGSHNY 182 (359)
Q Consensus 107 ~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g-l~~~~~-d~~i~v~d~~~~~~~~ 182 (359)
+|++.+.||.+++||..|.||+.|.+|+.||++.+..+..+ ...|.++.++|++ +++++. ++.+.|..+. . .
T Consensus 549 GhtDGascIdis~dGtklWTGGlDntvRcWDlregrqlqqhdF~SQIfSLg~cP~~dWlavGMens~vevlh~s-k-p-- 624 (705)
T KOG0639|consen 549 GHTDGASCIDISKDGTKLWTGGLDNTVRCWDLREGRQLQQHDFSSQIFSLGYCPTGDWLAVGMENSNVEVLHTS-K-P-- 624 (705)
T ss_pred CCCCCceeEEecCCCceeecCCCccceeehhhhhhhhhhhhhhhhhheecccCCCccceeeecccCcEEEEecC-C-c--
Confidence 99999999999999999999999999999999998766554 7789999999999 666665 5778777632 2 2
Q ss_pred cccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEc
Q 040274 183 SRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVP 222 (359)
Q Consensus 183 ~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~ 222 (359)
..|.-|. |.+.|.++.|.+.|+|+++.+.|..+..|-+
T Consensus 625 ~kyqlhl--heScVLSlKFa~cGkwfvStGkDnlLnawrt 662 (705)
T KOG0639|consen 625 EKYQLHL--HESCVLSLKFAYCGKWFVSTGKDNLLNAWRT 662 (705)
T ss_pred cceeecc--cccEEEEEEecccCceeeecCchhhhhhccC
Confidence 2233332 4458999999999999999999987665433
No 73
>KOG0319 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.83 E-value=1.7e-19 Score=168.34 Aligned_cols=174 Identities=17% Similarity=0.204 Sum_probs=152.1
Q ss_pred HhhhhccceEEEECCCCCEEEEecc------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCC
Q 040274 44 KVEKNLVHILWILPSSGRYMAVAGR------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTS 99 (359)
Q Consensus 44 ~~e~ll~~~~l~~spdg~~l~~~~~------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~ 99 (359)
.++.++..-.++|+++|.+|++... .+++++..||+.+|++++..+.+++|++.++
T Consensus 15 s~epiYtGG~~~~s~nG~~L~t~~~d~Vi~idv~t~~~~l~s~~~ed~d~ita~~l~~d~~~L~~a~rs~llrv~~L~tg 94 (775)
T KOG0319|consen 15 SLEPIYTGGPVAWSSNGQHLYTACGDRVIIIDVATGSIALPSGSNEDEDEITALALTPDEEVLVTASRSQLLRVWSLPTG 94 (775)
T ss_pred cccceecCCceeECCCCCEEEEecCceEEEEEccCCceecccCCccchhhhheeeecCCccEEEEeeccceEEEEEcccc
Confidence 3555556556999999999998654 7899999999999999999999999999999
Q ss_pred cceEEeec-CCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec---CCceeEEEcCCC----cEEEEcCCcEE
Q 040274 100 ALLIKMLY-HQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT---GHAKTLDFSQKG----LLAVGTGSFAQ 171 (359)
Q Consensus 100 ~~~~~~~~-h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~---~~v~~~~~s~~g----l~~~~~d~~i~ 171 (359)
..+..+.. |.+||.-++|+|.|.++++||.|+.++|||+..+.+++.|. |.|.++.|+|+- +++++.|+.++
T Consensus 95 k~irswKa~He~Pvi~ma~~~~g~LlAtggaD~~v~VWdi~~~~~th~fkG~gGvVssl~F~~~~~~~lL~sg~~D~~v~ 174 (775)
T KOG0319|consen 95 KLIRSWKAIHEAPVITMAFDPTGTLLATGGADGRVKVWDIKNGYCTHSFKGHGGVVSSLLFHPHWNRWLLASGATDGTVR 174 (775)
T ss_pred hHhHhHhhccCCCeEEEEEcCCCceEEeccccceEEEEEeeCCEEEEEecCCCceEEEEEeCCccchhheeecCCCceEE
Confidence 99999997 99999999999999999999999999999999999999994 458999999987 57778899999
Q ss_pred EEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 172 ILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 172 v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
+||+............|.. .|+++.|++|+..+++++.|.++.+|.
T Consensus 175 vwnl~~~~tcl~~~~~H~S----~vtsL~~~~d~~~~ls~~RDkvi~vwd 220 (775)
T KOG0319|consen 175 VWNLNDKRTCLHTMILHKS----AVTSLAFSEDSLELLSVGRDKVIIVWD 220 (775)
T ss_pred EEEcccCchHHHHHHhhhh----heeeeeeccCCceEEEeccCcEEEEee
Confidence 9997755444555666644 899999999999999999999887754
No 74
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=99.83 E-value=4.7e-20 Score=165.65 Aligned_cols=160 Identities=18% Similarity=0.226 Sum_probs=125.8
Q ss_pred eEEEECCCCCEEEEecc-----------------------------------ceeEEEEcCCC-CEEEEEeCCCeEEEEe
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------------------RTDLMRVNPFN-GVVSLGHSGGTVTMWK 95 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------------------~v~~l~~sp~~-~~l~tg~~dg~v~lwd 95 (359)
.++.||+.|..|++.+. .++|.+|+|.+ ..|+|++.||+++|||
T Consensus 218 ~sl~ys~Tg~~iLvvsg~aqakl~DRdG~~~~e~~KGDQYI~Dm~nTKGHia~lt~g~whP~~k~~FlT~s~DgtlRiWd 297 (641)
T KOG0772|consen 218 NSLQYSVTGDQILVVSGSAQAKLLDRDGFEIVEFSKGDQYIRDMYNTKGHIAELTCGCWHPDNKEEFLTCSYDGTLRIWD 297 (641)
T ss_pred ceeeecCCCCeEEEEecCcceeEEccCCceeeeeeccchhhhhhhccCCceeeeeccccccCcccceEEecCCCcEEEEe
Confidence 88999999887765443 79999999965 5799999999999999
Q ss_pred CCCCcc-eEEee-----cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCe--eeEee------cCCceeEEEcCCC-
Q 040274 96 PTTSAL-LIKML-----YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYE--VLQTL------TGHAKTLDFSQKG- 160 (359)
Q Consensus 96 ~~~~~~-~~~~~-----~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~--~~~~~------~~~v~~~~~s~~g- 160 (359)
++..+. +..+. +..-++++++|+|+|.+||+|+.||.|.+||.++.. +...+ ...|+||.||++|
T Consensus 298 v~~~k~q~qVik~k~~~g~Rv~~tsC~~nrdg~~iAagc~DGSIQ~W~~~~~~v~p~~~vk~AH~~g~~Itsi~FS~dg~ 377 (641)
T KOG0772|consen 298 VNNTKSQLQVIKTKPAGGKRVPVTSCAWNRDGKLIAAGCLDGSIQIWDKGSRTVRPVMKVKDAHLPGQDITSISFSYDGN 377 (641)
T ss_pred cCCchhheeEEeeccCCCcccCceeeecCCCcchhhhcccCCceeeeecCCcccccceEeeeccCCCCceeEEEeccccc
Confidence 986532 33332 334578999999999999999999999999986532 22222 1258999999999
Q ss_pred -cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeC
Q 040274 161 -LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHS 213 (359)
Q Consensus 161 -l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~ 213 (359)
|++-|.|+++.+||++...+.+....+.. ...+-+.++|||+..+|++|++
T Consensus 378 ~LlSRg~D~tLKvWDLrq~kkpL~~~tgL~--t~~~~tdc~FSPd~kli~TGtS 429 (641)
T KOG0772|consen 378 YLLSRGFDDTLKVWDLRQFKKPLNVRTGLP--TPFPGTDCCFSPDDKLILTGTS 429 (641)
T ss_pred hhhhccCCCceeeeeccccccchhhhcCCC--ccCCCCccccCCCceEEEeccc
Confidence 88999999999999988766666554432 2335678999999999999875
No 75
>KOG0643 consensus Translation initiation factor 3, subunit i (eIF-3i)/TGF-beta receptor-interacting protein (TRIP-1) [Translation, ribosomal structure and biogenesis; Signal transduction mechanisms]
Probab=99.82 E-value=9.1e-19 Score=145.74 Aligned_cols=148 Identities=20% Similarity=0.251 Sum_probs=129.0
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee-
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL- 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~- 147 (359)
+++.+.++.+|.+|++++.|.++.||-.-+|+.+.++.+|++.|+|+..+-+..+++||+.|.++++||+.+|+++.++
T Consensus 12 plTqiKyN~eGDLlFscaKD~~~~vw~s~nGerlGty~GHtGavW~~Did~~s~~liTGSAD~t~kLWDv~tGk~la~~k 91 (327)
T KOG0643|consen 12 PLTQIKYNREGDLLFSCAKDSTPTVWYSLNGERLGTYDGHTGAVWCCDIDWDSKHLITGSADQTAKLWDVETGKQLATWK 91 (327)
T ss_pred ccceEEecCCCcEEEEecCCCCceEEEecCCceeeeecCCCceEEEEEecCCcceeeeccccceeEEEEcCCCcEEEEee
Confidence 8999999999999999999999999998889999999999999999999999999999999999999999999999888
Q ss_pred -cCCceeEEEcCCC-cEEEEcC------CcEEEEcCCCCC------ccccccccccCCCCcceeEEEEccCCCEEEEEeC
Q 040274 148 -TGHAKTLDFSQKG-LLAVGTG------SFAQILGDFSGS------HNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHS 213 (359)
Q Consensus 148 -~~~v~~~~~s~~g-l~~~~~d------~~i~v~d~~~~~------~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~ 213 (359)
+.+|..+.|+++| ++..+.| +.|.+||++... .+...++.+ ...++++-|.|-+.+|++|+.
T Consensus 92 ~~~~Vk~~~F~~~gn~~l~~tD~~mg~~~~v~~fdi~~~~~~~~s~ep~~kI~t~----~skit~a~Wg~l~~~ii~Ghe 167 (327)
T KOG0643|consen 92 TNSPVKRVDFSFGGNLILASTDKQMGYTCFVSVFDIRDDSSDIDSEEPYLKIPTP----DSKITSALWGPLGETIIAGHE 167 (327)
T ss_pred cCCeeEEEeeccCCcEEEEEehhhcCcceEEEEEEccCChhhhcccCceEEecCC----ccceeeeeecccCCEEEEecC
Confidence 5678999999999 5555544 689999987542 223333333 347999999999999999999
Q ss_pred CCeEEEE
Q 040274 214 MGWSGIL 220 (359)
Q Consensus 214 dg~~~i~ 220 (359)
+|.+++|
T Consensus 168 ~G~is~~ 174 (327)
T KOG0643|consen 168 DGSISIY 174 (327)
T ss_pred CCcEEEE
Confidence 9998774
No 76
>PF08149 BING4CT: BING4CT (NUC141) domain; InterPro: IPR012952 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events. This C-terminal domain is found in the BING4 family of nucleolar WD40 repeat proteins [].
Probab=99.82 E-value=2.3e-20 Score=126.05 Aligned_cols=79 Identities=57% Similarity=0.933 Sum_probs=73.9
Q ss_pred cccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCCCceeeeccCCCCChhhhhhHHHHHhhhccCCCeeeeCC
Q 040274 185 YMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSEPNFDSWVANPFETSKQRREKEVHSLLDKLLLETIMLNP 264 (359)
Q Consensus 185 ~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~~~~~~~~~~~~~~~~~~~e~ev~~ll~~~~~~~i~~~~ 264 (359)
|+.|.. .+..|.++.|+|..++|.+|+..|+.+++++|+|++|++.++.|||++.+||+|+||++||+|+||++|++||
T Consensus 2 Ym~h~~-~~~~v~~~~F~PfEDvLgvGh~~G~sSiiVPGsGe~NfDs~e~NP~et~kqRrE~EV~~LLeKippd~I~LdP 80 (80)
T PF08149_consen 2 YMTHLK-PGSPVESLRFCPFEDVLGVGHSKGFSSIIVPGSGEPNFDSLEANPFETKKQRREREVRSLLEKIPPDMITLDP 80 (80)
T ss_pred CccccC-CCCeeeeeEEechHHeeEeeccCceeEEeccCCCCCCCCcccCCcccchhHHhHHHHHHHHHhCCccceecCc
Confidence 445532 6678999999999999999999999999999999999999999999999999999999999999999999997
No 77
>KOG1273 consensus WD40 repeat protein [General function prediction only]
Probab=99.82 E-value=7.6e-19 Score=149.34 Aligned_cols=194 Identities=14% Similarity=0.218 Sum_probs=142.2
Q ss_pred eeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee--
Q 040274 70 TDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL-- 147 (359)
Q Consensus 70 v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~-- 147 (359)
..|+.||+.|.+|++|+.||.|.|||+.|...-..+.+|..+|++++||++|+.|+|++.|..|.+||+..|.+++.+
T Consensus 26 a~~~~Fs~~G~~lAvGc~nG~vvI~D~~T~~iar~lsaH~~pi~sl~WS~dgr~LltsS~D~si~lwDl~~gs~l~rirf 105 (405)
T KOG1273|consen 26 AECCQFSRWGDYLAVGCANGRVVIYDFDTFRIARMLSAHVRPITSLCWSRDGRKLLTSSRDWSIKLWDLLKGSPLKRIRF 105 (405)
T ss_pred cceEEeccCcceeeeeccCCcEEEEEccccchhhhhhccccceeEEEecCCCCEeeeecCCceeEEEeccCCCceeEEEc
Confidence 578999999999999999999999999999888889999999999999999999999999999999999999998877
Q ss_pred cCCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE-----
Q 040274 148 TGHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI----- 219 (359)
Q Consensus 148 ~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i----- 219 (359)
..+|+.+.|+|.. .+++-.+..-.+-++..+...+.+...... ......+..|.+.|.++++|...|-+-+
T Consensus 106 ~spv~~~q~hp~k~n~~va~~~~~sp~vi~~s~~~h~~Lp~d~d~d-ln~sas~~~fdr~g~yIitGtsKGkllv~~a~t 184 (405)
T KOG1273|consen 106 DSPVWGAQWHPRKRNKCVATIMEESPVVIDFSDPKHSVLPKDDDGD-LNSSASHGVFDRRGKYIITGTSKGKLLVYDAET 184 (405)
T ss_pred cCccceeeeccccCCeEEEEEecCCcEEEEecCCceeeccCCCccc-cccccccccccCCCCEEEEecCcceEEEEecch
Confidence 7889999999976 444444433333332222111111111110 1112334468999999999999986544
Q ss_pred --------------------------EEcCCCCCceeeeccCCCCC----hhhhhhHHHHHhhhccCCCeeeeCC
Q 040274 220 --------------------------LVPRSSEPNFDSWVANPFET----SKQRREKEVHSLLDKLLLETIMLNP 264 (359)
Q Consensus 220 --------------------------~~~gs~~~~~~~~~~~~~~~----~~~~~e~ev~~ll~~~~~~~i~~~~ 264 (359)
++..+.|..|+.|+...... .....+..++.+.++++..-+.++.
T Consensus 185 ~e~vas~rits~~~IK~I~~s~~g~~liiNtsDRvIR~ye~~di~~~~r~~e~e~~~K~qDvVNk~~Wk~ccfs~ 259 (405)
T KOG1273|consen 185 LECVASFRITSVQAIKQIIVSRKGRFLIINTSDRVIRTYEISDIDDEGRDGEVEPEHKLQDVVNKLQWKKCCFSG 259 (405)
T ss_pred heeeeeeeechheeeeEEEEeccCcEEEEecCCceEEEEehhhhcccCccCCcChhHHHHHHHhhhhhhheeecC
Confidence 45566788888888763322 2333346677888888766555554
No 78
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.82 E-value=3.3e-19 Score=158.26 Aligned_cols=161 Identities=17% Similarity=0.221 Sum_probs=134.5
Q ss_pred eEEEECCCCCEEEEecc-----------------------------------------ceeEEEEcCCCCEEEEEeCCCe
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------------------------RTDLMRVNPFNGVVSLGHSGGT 90 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------------------------~v~~l~~sp~~~~l~tg~~dg~ 90 (359)
.+++++||+.+.++++. .+.+++.||||.||++|+.|..
T Consensus 146 ~~vals~d~~~~fsask~g~i~kw~v~tgk~~~~i~~~~ev~k~~~~~~k~~r~~h~keil~~avS~Dgkylatgg~d~~ 225 (479)
T KOG0299|consen 146 TSVALSPDDKRVFSASKDGTILKWDVLTGKKDRYIIERDEVLKSHGNPLKESRKGHVKEILTLAVSSDGKYLATGGRDRH 225 (479)
T ss_pred eEEEeeccccceeecCCCcceeeeehhcCcccccccccchhhhhccCCCCcccccccceeEEEEEcCCCcEEEecCCCce
Confidence 89999999999998876 5889999999999999999999
Q ss_pred EEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee---cCCceeEEEcCCC-cEEEE-
Q 040274 91 VTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL---TGHAKTLDFSQKG-LLAVG- 165 (359)
Q Consensus 91 v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~---~~~v~~~~~s~~g-l~~~~- 165 (359)
|.||++.+.+.+..+.+|.+.|.+++|-...+-|++++.|+.|++|++.....+-++ ++.|.+|.....+ .++++
T Consensus 226 v~Iw~~~t~ehv~~~~ghr~~V~~L~fr~gt~~lys~s~Drsvkvw~~~~~s~vetlyGHqd~v~~IdaL~reR~vtVGg 305 (479)
T KOG0299|consen 226 VQIWDCDTLEHVKVFKGHRGAVSSLAFRKGTSELYSASADRSVKVWSIDQLSYVETLYGHQDGVLGIDALSRERCVTVGG 305 (479)
T ss_pred EEEecCcccchhhcccccccceeeeeeecCccceeeeecCCceEEEehhHhHHHHHHhCCccceeeechhcccceEEecc
Confidence 999999999999999999999999999888888999999999999999987766666 4447777777777 66655
Q ss_pred cCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 166 TGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 166 ~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
.|+++++|++.. .....|.++.+ .+-|++|-.+ ..+++|+.+|.|.+
T Consensus 306 rDrT~rlwKi~e--esqlifrg~~~----sidcv~~In~-~HfvsGSdnG~IaL 352 (479)
T KOG0299|consen 306 RDRTVRLWKIPE--ESQLIFRGGEG----SIDCVAFIND-EHFVSGSDNGSIAL 352 (479)
T ss_pred ccceeEEEeccc--cceeeeeCCCC----CeeeEEEecc-cceeeccCCceEEE
Confidence 899999999733 33444555533 6888888744 56888888888665
No 79
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.82 E-value=5e-19 Score=157.14 Aligned_cols=181 Identities=12% Similarity=0.233 Sum_probs=147.2
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h 108 (359)
+++++|+||+||++|+. .|.+++|-....-+++++.|++|.+|+++....+.++.+|
T Consensus 206 l~~avS~Dgkylatgg~d~~v~Iw~~~t~ehv~~~~ghr~~V~~L~fr~gt~~lys~s~Drsvkvw~~~~~s~vetlyGH 285 (479)
T KOG0299|consen 206 LTLAVSSDGKYLATGGRDRHVQIWDCDTLEHVKVFKGHRGAVSSLAFRKGTSELYSASADRSVKVWSIDQLSYVETLYGH 285 (479)
T ss_pred EEEEEcCCCcEEEecCCCceEEEecCcccchhhcccccccceeeeeeecCccceeeeecCCceEEEehhHhHHHHHHhCC
Confidence 89999999999999997 7899999888888999999999999999998899999999
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCe-eeEee-cCCceeEEEcCCC-cEEEEcCCcEEEEcCCCCCcccccc
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYE-VLQTL-TGHAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRY 185 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~-~~~~~-~~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~ 185 (359)
.+.|.++....-++.+-+|+.|+++++|++..-. .+..- .+.+-|++|-.+. +++|+.+|.|.+|++.........-
T Consensus 286 qd~v~~IdaL~reR~vtVGgrDrT~rlwKi~eesqlifrg~~~sidcv~~In~~HfvsGSdnG~IaLWs~~KKkplf~~~ 365 (479)
T KOG0299|consen 286 QDGVLGIDALSRERCVTVGGRDRTVRLWKIPEESQLIFRGGEGSIDCVAFINDEHFVSGSDNGSIALWSLLKKKPLFTSR 365 (479)
T ss_pred ccceeeechhcccceEEeccccceeEEEeccccceeeeeCCCCCeeeEEEecccceeeccCCceEEEeeecccCceeEee
Confidence 9999999988888888888899999999995432 22221 4578899998887 9999999999999976653332222
Q ss_pred ccccCCC-------CcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCCCceeee
Q 040274 186 MGNSMVK-------GYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSEPNFDSW 232 (359)
Q Consensus 186 ~~~~~~~-------~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~~~~~~~ 232 (359)
..|...+ ...|++++..|..+++++|+.+|.+++|....+-..+.+.
T Consensus 366 ~AHgv~~~~~~~~~~~Witsla~i~~sdL~asGS~~G~vrLW~i~~g~r~i~~l 419 (479)
T KOG0299|consen 366 LAHGVIPELDPVNGNFWITSLAVIPGSDLLASGSWSGCVRLWKIEDGLRAINLL 419 (479)
T ss_pred ccccccCCccccccccceeeeEecccCceEEecCCCCceEEEEecCCcccccee
Confidence 2332211 1279999999999999999999999999887765544433
No 80
>KOG0281 consensus Beta-TrCP (transducin repeats containing)/Slimb proteins [Function unknown]
Probab=99.82 E-value=1.1e-19 Score=156.20 Aligned_cols=157 Identities=16% Similarity=0.266 Sum_probs=129.2
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
.|.|+.+. ...+++|..|.+|.|||.++..++..+.||++.|.|+.|. .+.+++|+.|.+|++||..+++++.++-
T Consensus 199 gVYClQYD--D~kiVSGlrDnTikiWD~n~~~c~~~L~GHtGSVLCLqyd--~rviisGSSDsTvrvWDv~tge~l~tli 274 (499)
T KOG0281|consen 199 GVYCLQYD--DEKIVSGLRDNTIKIWDKNSLECLKILTGHTGSVLCLQYD--ERVIVSGSSDSTVRVWDVNTGEPLNTLI 274 (499)
T ss_pred ceEEEEec--chhhhcccccCceEEeccccHHHHHhhhcCCCcEEeeecc--ceEEEecCCCceEEEEeccCCchhhHHh
Confidence 78888874 4589999999999999999999999999999999999984 5699999999999999999999999984
Q ss_pred C---CceeEEEcCCCcEEEEcCCcEEEEcCCCCCc--cccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE----
Q 040274 149 G---HAKTLDFSQKGLLAVGTGSFAQILGDFSGSH--NYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI---- 219 (359)
Q Consensus 149 ~---~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~--~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i---- 219 (359)
+ .|..+.|+..-+++++.|.++.|||+..+.. ....+.+|.. .|+.+.| +.+++++++.|.++.+
T Consensus 275 hHceaVLhlrf~ng~mvtcSkDrsiaVWdm~sps~it~rrVLvGHrA----aVNvVdf--d~kyIVsASgDRTikvW~~s 348 (499)
T KOG0281|consen 275 HHCEAVLHLRFSNGYMVTCSKDRSIAVWDMASPTDITLRRVLVGHRA----AVNVVDF--DDKYIVSASGDRTIKVWSTS 348 (499)
T ss_pred hhcceeEEEEEeCCEEEEecCCceeEEEeccCchHHHHHHHHhhhhh----heeeecc--ccceEEEecCCceEEEEecc
Confidence 4 4678888754499999999999999865531 1223455644 7888888 4458888888887665
Q ss_pred ------------------------EEcCCCCCceeeeccC
Q 040274 220 ------------------------LVPRSSEPNFDSWVAN 235 (359)
Q Consensus 220 ------------------------~~~gs~~~~~~~~~~~ 235 (359)
+++|+.|.+|++|++.
T Consensus 349 t~efvRtl~gHkRGIAClQYr~rlvVSGSSDntIRlwdi~ 388 (499)
T KOG0281|consen 349 TCEFVRTLNGHKRGIACLQYRDRLVVSGSSDNTIRLWDIE 388 (499)
T ss_pred ceeeehhhhcccccceehhccCeEEEecCCCceEEEEecc
Confidence 5788888888888864
No 81
>KOG0313 consensus Microtubule binding protein YTM1 (contains WD40 repeats) [Cytoskeleton]
Probab=99.82 E-value=8.7e-19 Score=152.24 Aligned_cols=164 Identities=15% Similarity=0.189 Sum_probs=140.1
Q ss_pred eEEEECCCCCEEEEecc------------------------------------------------ceeEEEEcCCCCEEE
Q 040274 52 ILWILPSSGRYMAVAGR------------------------------------------------RTDLMRVNPFNGVVS 83 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------------------------------~v~~l~~sp~~~~l~ 83 (359)
-++...++|..+++|+. +|.++.|++ ...++
T Consensus 197 ~sVsv~~sgtr~~SgS~D~~lkiWs~~~~~~~~~E~~s~~rrk~~~~~~~~~~r~P~vtl~GHt~~Vs~V~w~d-~~v~y 275 (423)
T KOG0313|consen 197 DSVSVDSSGTRFCSGSWDTMLKIWSVETDEEDELESSSNRRRKKQKREKEGGTRTPLVTLEGHTEPVSSVVWSD-ATVIY 275 (423)
T ss_pred eEEEecCCCCeEEeecccceeeecccCCCccccccccchhhhhhhhhhhcccccCceEEecccccceeeEEEcC-CCceE
Confidence 67888899999999886 899999998 77999
Q ss_pred EEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCe---eeEeec---CCceeEEEc
Q 040274 84 LGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYE---VLQTLT---GHAKTLDFS 157 (359)
Q Consensus 84 tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~---~~~~~~---~~v~~~~~s 157 (359)
+++.|.+|+.||+.++..+.++.+ ...++++.++|...+|++|+.|..|++||.+++. +.+++- ..|.++.|+
T Consensus 276 S~SwDHTIk~WDletg~~~~~~~~-~ksl~~i~~~~~~~Ll~~gssdr~irl~DPR~~~gs~v~~s~~gH~nwVssvkws 354 (423)
T KOG0313|consen 276 SVSWDHTIKVWDLETGGLKSTLTT-NKSLNCISYSPLSKLLASGSSDRHIRLWDPRTGDGSVVSQSLIGHKNWVSSVKWS 354 (423)
T ss_pred eecccceEEEEEeecccceeeeec-CcceeEeecccccceeeecCCCCceeecCCCCCCCceeEEeeecchhhhhheecC
Confidence 999999999999999998888866 6678999999999999999999999999999853 345553 458999999
Q ss_pred CCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEc
Q 040274 158 QKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVP 222 (359)
Q Consensus 158 ~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~ 222 (359)
|.. |++++.|+++.+||++....++..+.+|.. .|.++.|+ .+..|++|+.|..++|+-.
T Consensus 355 p~~~~~~~S~S~D~t~klWDvRS~k~plydI~~h~D----Kvl~vdW~-~~~~IvSGGaD~~l~i~~~ 417 (423)
T KOG0313|consen 355 PTNEFQLVSGSYDNTVKLWDVRSTKAPLYDIAGHND----KVLSVDWN-EGGLIVSGGADNKLRIFKG 417 (423)
T ss_pred CCCceEEEEEecCCeEEEEEeccCCCcceeeccCCc----eEEEEecc-CCceEEeccCcceEEEecc
Confidence 988 889999999999998887656666777644 89999997 4567888888887777643
No 82
>KOG0281 consensus Beta-TrCP (transducin repeats containing)/Slimb proteins [Function unknown]
Probab=99.81 E-value=1.3e-19 Score=155.81 Aligned_cols=158 Identities=18% Similarity=0.289 Sum_probs=133.7
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCee---eE
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEV---LQ 145 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~---~~ 145 (359)
.|.|+.|. ...|++|+.|.+|++||.++++++.++.+|...|..+.|+. .+++|++.|.++.+||+.+... .+
T Consensus 239 SVLCLqyd--~rviisGSSDsTvrvWDv~tge~l~tlihHceaVLhlrf~n--g~mvtcSkDrsiaVWdm~sps~it~rr 314 (499)
T KOG0281|consen 239 SVLCLQYD--ERVIVSGSSDSTVRVWDVNTGEPLNTLIHHCEAVLHLRFSN--GYMVTCSKDRSIAVWDMASPTDITLRR 314 (499)
T ss_pred cEEeeecc--ceEEEecCCCceEEEEeccCCchhhHHhhhcceeEEEEEeC--CEEEEecCCceeEEEeccCchHHHHHH
Confidence 78888775 56999999999999999999999999999999999999974 4999999999999999987542 22
Q ss_pred eecC---CceeEEEcCCCcEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE---
Q 040274 146 TLTG---HAKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI--- 219 (359)
Q Consensus 146 ~~~~---~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i--- 219 (359)
.+.| .|+.+.|+..-+++++.|.+|++|++.+ ...+.++.+|.. .|.|+.+ .|+++++|++|.++++
T Consensus 315 VLvGHrAaVNvVdfd~kyIVsASgDRTikvW~~st-~efvRtl~gHkR----GIAClQY--r~rlvVSGSSDntIRlwdi 387 (499)
T KOG0281|consen 315 VLVGHRAAVNVVDFDDKYIVSASGDRTIKVWSTST-CEFVRTLNGHKR----GIACLQY--RDRLVVSGSSDNTIRLWDI 387 (499)
T ss_pred HHhhhhhheeeeccccceEEEecCCceEEEEeccc-eeeehhhhcccc----cceehhc--cCeEEEecCCCceEEEEec
Confidence 3334 4788888776688999999999999654 477888888864 6888876 7899999999999988
Q ss_pred -------------------------EEcCCCCCceeeeccCCC
Q 040274 220 -------------------------LVPRSSEPNFDSWVANPF 237 (359)
Q Consensus 220 -------------------------~~~gs~~~~~~~~~~~~~ 237 (359)
+++|+-|+.+++|+.+.-
T Consensus 388 ~~G~cLRvLeGHEeLvRciRFd~krIVSGaYDGkikvWdl~aa 430 (499)
T KOG0281|consen 388 ECGACLRVLEGHEELVRCIRFDNKRIVSGAYDGKIKVWDLQAA 430 (499)
T ss_pred cccHHHHHHhchHHhhhheeecCceeeeccccceEEEEecccc
Confidence 588999999999998743
No 83
>KOG1274 consensus WD40 repeat protein [General function prediction only]
Probab=99.81 E-value=1.3e-18 Score=165.99 Aligned_cols=153 Identities=18% Similarity=0.257 Sum_probs=132.8
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
++.+++|+-+|.+++.|+.|-.|.+-+..+......+.+|.++|.++.|+|.+.+||+++.||.|++||+.++.+..++.
T Consensus 98 p~r~~~v~g~g~~iaagsdD~~vK~~~~~D~s~~~~lrgh~apVl~l~~~p~~~fLAvss~dG~v~iw~~~~~~~~~tl~ 177 (933)
T KOG1274|consen 98 PIRDLAVSGSGKMIAAGSDDTAVKLLNLDDSSQEKVLRGHDAPVLQLSYDPKGNFLAVSSCDGKVQIWDLQDGILSKTLT 177 (933)
T ss_pred cceEEEEecCCcEEEeecCceeEEEEeccccchheeecccCCceeeeeEcCCCCEEEEEecCceEEEEEcccchhhhhcc
Confidence 89999999999999999999999999999999999999999999999999999999999999999999999988777762
Q ss_pred C-----------CceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 149 G-----------HAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 149 ~-----------~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
+ .+..++|+|+| +++.+.|+.|.+|+ +.+......+.... +...++++.|+|.|.|||+++-+|
T Consensus 178 ~v~k~n~~~~s~i~~~~aW~Pk~g~la~~~~d~~Vkvy~-r~~we~~f~Lr~~~--~ss~~~~~~wsPnG~YiAAs~~~g 254 (933)
T KOG1274|consen 178 GVDKDNEFILSRICTRLAWHPKGGTLAVPPVDNTVKVYS-RKGWELQFKLRDKL--SSSKFSDLQWSPNGKYIAASTLDG 254 (933)
T ss_pred cCCccccccccceeeeeeecCCCCeEEeeccCCeEEEEc-cCCceeheeecccc--cccceEEEEEcCCCcEEeeeccCC
Confidence 1 24778999996 99999999999999 45544444444332 333499999999999999999999
Q ss_pred eEEEEEcCC
Q 040274 216 WSGILVPRS 224 (359)
Q Consensus 216 ~~~i~~~gs 224 (359)
.+.||..-+
T Consensus 255 ~I~vWnv~t 263 (933)
T KOG1274|consen 255 QILVWNVDT 263 (933)
T ss_pred cEEEEeccc
Confidence 999998764
No 84
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=99.81 E-value=2e-18 Score=149.28 Aligned_cols=170 Identities=15% Similarity=0.231 Sum_probs=144.9
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h 108 (359)
|+++++|+.+++++||. +|+|+.||.+|.+|+||+.+|.|.||...++.....+...
T Consensus 68 Favsl~P~~~l~aTGGgDD~AflW~~~~ge~~~eltgHKDSVt~~~FshdgtlLATGdmsG~v~v~~~stg~~~~~~~~e 147 (399)
T KOG0296|consen 68 FAVSLHPNNNLVATGGGDDLAFLWDISTGEFAGELTGHKDSVTCCSFSHDGTLLATGDMSGKVLVFKVSTGGEQWKLDQE 147 (399)
T ss_pred EEEEeCCCCceEEecCCCceEEEEEccCCcceeEecCCCCceEEEEEccCceEEEecCCCccEEEEEcccCceEEEeecc
Confidence 99999999999999987 8999999999999999999999999999999988888766
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecC---CceeEEEcCCC--cEEEEcCCcEEEEcCCCCCcccc
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTG---HAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYS 183 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~---~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~ 183 (359)
-..+..+.|+|-+..|+.|+.||.+.+|.+.+....+.+.+ ++++-.|.|+| ++++..||+|++||+.++ .++.
T Consensus 148 ~~dieWl~WHp~a~illAG~~DGsvWmw~ip~~~~~kv~~Gh~~~ct~G~f~pdGKr~~tgy~dgti~~Wn~ktg-~p~~ 226 (399)
T KOG0296|consen 148 VEDIEWLKWHPRAHILLAGSTDGSVWMWQIPSQALCKVMSGHNSPCTCGEFIPDGKRILTGYDDGTIIVWNPKTG-QPLH 226 (399)
T ss_pred cCceEEEEecccccEEEeecCCCcEEEEECCCcceeeEecCCCCCcccccccCCCceEEEEecCceEEEEecCCC-ceeE
Confidence 77899999999999999999999999999998766677754 47888999999 788888999999997665 3433
Q ss_pred ccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCC
Q 040274 184 RYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSS 225 (359)
Q Consensus 184 ~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~ 225 (359)
.+.+. .+....++.++..+..++.|+.++.+.+...+++
T Consensus 227 ~~~~~---e~~~~~~~~~~~~~~~~~~g~~e~~~~~~~~~sg 265 (399)
T KOG0296|consen 227 KITQA---EGLELPCISLNLAGSTLTKGNSEGVACGVNNGSG 265 (399)
T ss_pred Eeccc---ccCcCCccccccccceeEeccCCccEEEEccccc
Confidence 33322 1225778889999999999999998877666554
No 85
>KOG4283 consensus Transcription-coupled repair protein CSA, contains WD40 domain [Transcription; Replication, recombination and repair]
Probab=99.81 E-value=5.7e-19 Score=148.82 Aligned_cols=180 Identities=14% Similarity=0.195 Sum_probs=148.7
Q ss_pred eEEEECC-CCCEEEEecc--------------------------------------ceeEEEEcC-CCCEEEEEeCCCeE
Q 040274 52 ILWILPS-SGRYMAVAGR--------------------------------------RTDLMRVNP-FNGVVSLGHSGGTV 91 (359)
Q Consensus 52 ~~l~~sp-dg~~l~~~~~--------------------------------------~v~~l~~sp-~~~~l~tg~~dg~v 91 (359)
.+|.+.+ .|+|+++|+. .|..+.|-| |..+|.+++.|.++
T Consensus 47 NsL~id~tegrymlSGgadgsi~v~Dl~n~t~~e~s~li~k~~c~v~~~h~~~Hky~iss~~WyP~DtGmFtssSFDhtl 126 (397)
T KOG4283|consen 47 NSLQIDLTEGRYMLSGGADGSIAVFDLQNATDYEASGLIAKHKCIVAKQHENGHKYAISSAIWYPIDTGMFTSSSFDHTL 126 (397)
T ss_pred ceeeeccccceEEeecCCCccEEEEEeccccchhhccceeheeeeccccCCccceeeeeeeEEeeecCceeecccccceE
Confidence 6777766 7889998887 789999999 88899999999999
Q ss_pred EEEeCCCCcceEEeecCCCCeEEEEEec---CCCEEEEecCCCeEEEEEcCCCeeeEeecCC---ceeEEEcCCC---cE
Q 040274 92 TMWKPTTSALLIKMLYHQGPVSALAFHP---NGHLMATTGKECKIKIWDLRKYEVLQTLTGH---AKTLDFSQKG---LL 162 (359)
Q Consensus 92 ~lwd~~~~~~~~~~~~h~~~v~~l~~~p---~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~~---v~~~~~s~~g---l~ 162 (359)
.+||.+|.+....|.. .+.|++-+|+| ...++|+|..|-.|++-|+.+|.+.+++.+| |.++.|+|.. |+
T Consensus 127 KVWDtnTlQ~a~~F~m-e~~VYshamSp~a~sHcLiA~gtr~~~VrLCDi~SGs~sH~LsGHr~~vlaV~Wsp~~e~vLa 205 (397)
T KOG4283|consen 127 KVWDTNTLQEAVDFKM-EGKVYSHAMSPMAMSHCLIAAGTRDVQVRLCDIASGSFSHTLSGHRDGVLAVEWSPSSEWVLA 205 (397)
T ss_pred EEeecccceeeEEeec-CceeehhhcChhhhcceEEEEecCCCcEEEEeccCCcceeeeccccCceEEEEeccCceeEEE
Confidence 9999999988888754 77899999998 3457888888999999999999999999654 8999999988 77
Q ss_pred EEEcCCcEEEEcCCCCCcccccccccc----------CCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCCCceeee
Q 040274 163 AVGTGSFAQILGDFSGSHNYSRYMGNS----------MVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSEPNFDSW 232 (359)
Q Consensus 163 ~~~~d~~i~v~d~~~~~~~~~~~~~~~----------~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~~~~~~~ 232 (359)
+++.||.|++||++........+..|. ..|.+.|..++|+.+++++++++.|..+++|.+.+|..+.+-+
T Consensus 206 tgsaDg~irlWDiRrasgcf~~lD~hn~k~~p~~~~n~ah~gkvngla~tSd~~~l~~~gtd~r~r~wn~~~G~ntl~~~ 285 (397)
T KOG4283|consen 206 TGSADGAIRLWDIRRASGCFRVLDQHNTKRPPILKTNTAHYGKVNGLAWTSDARYLASCGTDDRIRVWNMESGRNTLREF 285 (397)
T ss_pred ecCCCceEEEEEeecccceeEEeecccCccCccccccccccceeeeeeecccchhhhhccCccceEEeecccCccccccc
Confidence 888999999999876422222222111 1245589999999999999999999999999999998877655
No 86
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=99.81 E-value=1.3e-18 Score=153.58 Aligned_cols=167 Identities=15% Similarity=0.194 Sum_probs=144.2
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h 108 (359)
.++...|....+++||. .|+.+.|+|+...+++++.|-.|+||.............|
T Consensus 223 ~ald~~~s~~~ilTGG~d~~av~~d~~s~q~l~~~~Gh~kki~~v~~~~~~~~v~~aSad~~i~vws~~~~s~~~~~~~h 302 (506)
T KOG0289|consen 223 TALDIIPSSSKILTGGEDKTAVLFDKPSNQILATLKGHTKKITSVKFHKDLDTVITASADEIIRVWSVPLSSEPTSSRPH 302 (506)
T ss_pred eEEeecCCCCcceecCCCCceEEEecchhhhhhhccCcceEEEEEEeccchhheeecCCcceEEeeccccccCccccccc
Confidence 66666666677888776 7999999999999999999999999999888777888899
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecC-----CceeEEEcCCC--cEEEEcCCcEEEEcCCCCCcc
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTG-----HAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHN 181 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~-----~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~ 181 (359)
..+|+.+..+|+|.||++++.|+++.+.|++++..+..... .+++.+|+||| +.++..|+.|.|||+... ..
T Consensus 303 ~~~V~~ls~h~tgeYllsAs~d~~w~Fsd~~~g~~lt~vs~~~s~v~~ts~~fHpDgLifgtgt~d~~vkiwdlks~-~~ 381 (506)
T KOG0289|consen 303 EEPVTGLSLHPTGEYLLSASNDGTWAFSDISSGSQLTVVSDETSDVEYTSAAFHPDGLIFGTGTPDGVVKIWDLKSQ-TN 381 (506)
T ss_pred cccceeeeeccCCcEEEEecCCceEEEEEccCCcEEEEEeeccccceeEEeeEcCCceEEeccCCCceEEEEEcCCc-cc
Confidence 99999999999999999999999999999999988776632 26999999999 556677999999997554 57
Q ss_pred ccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 182 YSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 182 ~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
...+++|.+ +|..++|+.+|-||+++++|+.+.+|.--
T Consensus 382 ~a~Fpght~----~vk~i~FsENGY~Lat~add~~V~lwDLR 419 (506)
T KOG0289|consen 382 VAKFPGHTG----PVKAISFSENGYWLATAADDGSVKLWDLR 419 (506)
T ss_pred cccCCCCCC----ceeEEEeccCceEEEEEecCCeEEEEEeh
Confidence 777888866 99999999999999999999876666543
No 87
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=99.81 E-value=5.2e-19 Score=159.03 Aligned_cols=168 Identities=13% Similarity=0.107 Sum_probs=130.9
Q ss_pred eEEEECCCCCEEEEecc----------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcc--
Q 040274 52 ILWILPSSGRYMAVAGR----------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSAL-- 101 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~----------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~-- 101 (359)
..+++.|.|..|++|+- .|+++.|++.+..|++.+.....+|+|-...+.
T Consensus 171 sal~~Dp~GaR~~sGs~Dy~v~~wDf~gMdas~~~fr~l~P~E~h~i~sl~ys~Tg~~iLvvsg~aqakl~DRdG~~~~e 250 (641)
T KOG0772|consen 171 SALAVDPSGARFVSGSLDYTVKFWDFQGMDASMRSFRQLQPCETHQINSLQYSVTGDQILVVSGSAQAKLLDRDGFEIVE 250 (641)
T ss_pred EEeeecCCCceeeeccccceEEEEecccccccchhhhccCcccccccceeeecCCCCeEEEEecCcceeEEccCCceeee
Confidence 88999999999999987 799999999999988888888888998653322
Q ss_pred -------e---EEeecCCCCeEEEEEecCC-CEEEEecCCCeEEEEEcCCCe-eeEee--------cCCceeEEEcCCC-
Q 040274 102 -------L---IKMLYHQGPVSALAFHPNG-HLMATTGKECKIKIWDLRKYE-VLQTL--------TGHAKTLDFSQKG- 160 (359)
Q Consensus 102 -------~---~~~~~h~~~v~~l~~~p~g-~~l~s~~~d~~i~vwd~~~~~-~~~~~--------~~~v~~~~~s~~g- 160 (359)
+ ...++|...++|.+|+|.. ..|+|++.||++++||+...+ .+..+ .-++++|+|+|+|
T Consensus 251 ~~KGDQYI~Dm~nTKGHia~lt~g~whP~~k~~FlT~s~DgtlRiWdv~~~k~q~qVik~k~~~g~Rv~~tsC~~nrdg~ 330 (641)
T KOG0772|consen 251 FSKGDQYIRDMYNTKGHIAELTCGCWHPDNKEEFLTCSYDGTLRIWDVNNTKSQLQVIKTKPAGGKRVPVTSCAWNRDGK 330 (641)
T ss_pred eeccchhhhhhhccCCceeeeeccccccCcccceEEecCCCcEEEEecCCchhheeEEeeccCCCcccCceeeecCCCcc
Confidence 1 2334899999999999954 469999999999999998643 23333 1247999999999
Q ss_pred -cEEEEcCCcEEEEcCCCCCcccccc--ccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 161 -LLAVGTGSFAQILGDFSGSHNYSRY--MGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 161 -l~~~~~d~~i~v~d~~~~~~~~~~~--~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
+++++.||.|.+|+..........+ ..|. .+..|+|+.||+||++|++-+.|+.+.+|.
T Consensus 331 ~iAagc~DGSIQ~W~~~~~~v~p~~~vk~AH~--~g~~Itsi~FS~dg~~LlSRg~D~tLKvWD 392 (641)
T KOG0772|consen 331 LIAAGCLDGSIQIWDKGSRTVRPVMKVKDAHL--PGQDITSISFSYDGNYLLSRGFDDTLKVWD 392 (641)
T ss_pred hhhhcccCCceeeeecCCcccccceEeeeccC--CCCceeEEEeccccchhhhccCCCceeeee
Confidence 6777889999999963322222111 2332 455899999999999999999999888753
No 88
>KOG0293 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.81 E-value=8e-19 Score=153.93 Aligned_cols=146 Identities=9% Similarity=0.139 Sum_probs=120.1
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCc---ceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeE
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSA---LLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQ 145 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~---~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~ 145 (359)
.|+-+.||++|++||+++.|.+..+|.+.... ...++.+|..+|..+.||||.++|++|+.|..+.+||+.+|.+.+
T Consensus 226 EVWfl~FS~nGkyLAsaSkD~Taiiw~v~~d~~~kl~~tlvgh~~~V~yi~wSPDdryLlaCg~~e~~~lwDv~tgd~~~ 305 (519)
T KOG0293|consen 226 EVWFLQFSHNGKYLASASKDSTAIIWIVVYDVHFKLKKTLVGHSQPVSYIMWSPDDRYLLACGFDEVLSLWDVDTGDLRH 305 (519)
T ss_pred cEEEEEEcCCCeeEeeccCCceEEEEEEecCcceeeeeeeecccCceEEEEECCCCCeEEecCchHheeeccCCcchhhh
Confidence 89999999999999999999999999876443 366778999999999999999999999999999999999999988
Q ss_pred eec----CCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 146 TLT----GHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 146 ~~~----~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
.++ ..+.+++|.||| +++|+.|++|..||+... ......+. ....|.+++.++||.++++.+.|..+++
T Consensus 306 ~y~~~~~~S~~sc~W~pDg~~~V~Gs~dr~i~~wdlDgn--~~~~W~gv---r~~~v~dlait~Dgk~vl~v~~d~~i~l 380 (519)
T KOG0293|consen 306 LYPSGLGFSVSSCAWCPDGFRFVTGSPDRTIIMWDLDGN--ILGNWEGV---RDPKVHDLAITYDGKYVLLVTVDKKIRL 380 (519)
T ss_pred hcccCcCCCcceeEEccCCceeEecCCCCcEEEecCCcc--hhhccccc---ccceeEEEEEcCCCcEEEEEecccceee
Confidence 883 347999999999 999999999999995322 22222222 2235888888888888877777766554
No 89
>KOG1407 consensus WD40 repeat protein [Function unknown]
Probab=99.81 E-value=1.9e-18 Score=143.35 Aligned_cols=173 Identities=17% Similarity=0.232 Sum_probs=144.7
Q ss_pred eEEEECCCCCEEEEecc----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCC
Q 040274 52 ILWILPSSGRYMAVAGR----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQ 109 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~ 109 (359)
+-+.|+|+|.+++.++. .++.++|+-++.+|+.....|+|.|.....-+++.++.+|.
T Consensus 110 i~i~wsp~g~~~~~~~kdD~it~id~r~~~~~~~~~~~~e~ne~~w~~~nd~Fflt~GlG~v~ILsypsLkpv~si~AH~ 189 (313)
T KOG1407|consen 110 INITWSPDGEYIAVGNKDDRITFIDARTYKIVNEEQFKFEVNEISWNNSNDLFFLTNGLGCVEILSYPSLKPVQSIKAHP 189 (313)
T ss_pred eEEEEcCCCCEEEEecCcccEEEEEecccceeehhcccceeeeeeecCCCCEEEEecCCceEEEEeccccccccccccCC
Confidence 88999999999999987 78999999888888888888999999999999999999999
Q ss_pred CCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee---cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccc
Q 040274 110 GPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL---TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSR 184 (359)
Q Consensus 110 ~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~---~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~ 184 (359)
....|+.|+|+|+|||+|+.|-.+.+||+...-|++.+ .-+|..+.||.+| +++++.|..|-|=++.++.. +..
T Consensus 190 snCicI~f~p~GryfA~GsADAlvSLWD~~ELiC~R~isRldwpVRTlSFS~dg~~lASaSEDh~IDIA~vetGd~-~~e 268 (313)
T KOG1407|consen 190 SNCICIEFDPDGRYFATGSADALVSLWDVDELICERCISRLDWPVRTLSFSHDGRMLASASEDHFIDIAEVETGDR-VWE 268 (313)
T ss_pred cceEEEEECCCCceEeeccccceeeccChhHhhhheeeccccCceEEEEeccCcceeeccCccceEEeEecccCCe-EEE
Confidence 99999999999999999999999999999987777777 4579999999999 66777888998888766643 333
Q ss_pred cccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCCCceeeec
Q 040274 185 YMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSEPNFDSWV 233 (359)
Q Consensus 185 ~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~~~~~~~~ 233 (359)
++. .++...++|+|...+||.+++|..- ......+++++|-
T Consensus 269 I~~-----~~~t~tVAWHPk~~LLAyA~ddk~~---d~~reag~vKiFG 309 (313)
T KOG1407|consen 269 IPC-----EGPTFTVAWHPKRPLLAYACDDKDG---DSNREAGTVKIFG 309 (313)
T ss_pred eec-----cCCceeEEecCCCceeeEEecCCCC---ccccccceeEEec
Confidence 332 2378999999999999998887632 2233345666654
No 90
>KOG0294 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.80 E-value=1.7e-18 Score=147.13 Aligned_cols=140 Identities=22% Similarity=0.346 Sum_probs=118.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCC--EEEEecCCCeEEEEEcCCCeeeEe
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGH--LMATTGKECKIKIWDLRKYEVLQT 146 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~--~l~s~~~d~~i~vwd~~~~~~~~~ 146 (359)
++++++.+ +.++++|+.|.+|+|||+.+...+..+..|.+.|+++.|.++-. .|++|+.||.|.+|+.....++.+
T Consensus 45 sitavAVs--~~~~aSGssDetI~IYDm~k~~qlg~ll~HagsitaL~F~~~~S~shLlS~sdDG~i~iw~~~~W~~~~s 122 (362)
T KOG0294|consen 45 SITALAVS--GPYVASGSSDETIHIYDMRKRKQLGILLSHAGSITALKFYPPLSKSHLLSGSDDGHIIIWRVGSWELLKS 122 (362)
T ss_pred ceeEEEec--ceeEeccCCCCcEEEEeccchhhhcceeccccceEEEEecCCcchhheeeecCCCcEEEEEcCCeEEeee
Confidence 78888875 78999999999999999999988999999999999999998765 899999999999999999999888
Q ss_pred ec---CCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCe
Q 040274 147 LT---GHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGW 216 (359)
Q Consensus 147 ~~---~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~ 216 (359)
+. +.|+.++++|.| -++++.|+.+++||+.++......-..+ ..+.+.|+|.|++++++..++.
T Consensus 123 lK~H~~~Vt~lsiHPS~KLALsVg~D~~lr~WNLV~Gr~a~v~~L~~------~at~v~w~~~Gd~F~v~~~~~i 191 (362)
T KOG0294|consen 123 LKAHKGQVTDLSIHPSGKLALSVGGDQVLRTWNLVRGRVAFVLNLKN------KATLVSWSPQGDHFVVSGRNKI 191 (362)
T ss_pred ecccccccceeEecCCCceEEEEcCCceeeeehhhcCccceeeccCC------cceeeEEcCCCCEEEEEeccEE
Confidence 84 459999999999 6788999999999987774443333333 2345888888888887777764
No 91
>KOG0640 consensus mRNA cleavage stimulating factor complex; subunit 1 [RNA processing and modification]
Probab=99.80 E-value=1.4e-18 Score=147.37 Aligned_cols=127 Identities=17% Similarity=0.304 Sum_probs=115.8
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML 106 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~ 106 (359)
.+|.|+|....|++|+. +|.++.|+|.|.+|+.|....++++||++|.++-....
T Consensus 176 n~l~FHPre~ILiS~srD~tvKlFDfsK~saKrA~K~~qd~~~vrsiSfHPsGefllvgTdHp~~rlYdv~T~Qcfvsan 255 (430)
T KOG0640|consen 176 NDLDFHPRETILISGSRDNTVKLFDFSKTSAKRAFKVFQDTEPVRSISFHPSGEFLLVGTDHPTLRLYDVNTYQCFVSAN 255 (430)
T ss_pred cceeecchhheEEeccCCCeEEEEecccHHHHHHHHHhhccceeeeEeecCCCceEEEecCCCceeEEeccceeEeeecC
Confidence 89999999999999988 89999999999999999999999999999988765533
Q ss_pred ---cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee-----cCCceeEEEcCCC--cEEEEcCCcEEEEcCC
Q 040274 107 ---YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL-----TGHAKTLDFSQKG--LLAVGTGSFAQILGDF 176 (359)
Q Consensus 107 ---~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~-----~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~ 176 (359)
.|++.|+++.+++.|++.+|++.||.|++||-.+++|+.++ ...|.+..|..+| +++.|.|..+.+|.+.
T Consensus 256 Pd~qht~ai~~V~Ys~t~~lYvTaSkDG~IklwDGVS~rCv~t~~~AH~gsevcSa~Ftkn~kyiLsSG~DS~vkLWEi~ 335 (430)
T KOG0640|consen 256 PDDQHTGAITQVRYSSTGSLYVTASKDGAIKLWDGVSNRCVRTIGNAHGGSEVCSAVFTKNGKYILSSGKDSTVKLWEIS 335 (430)
T ss_pred cccccccceeEEEecCCccEEEEeccCCcEEeeccccHHHHHHHHhhcCCceeeeEEEccCCeEEeecCCcceeeeeeec
Confidence 68999999999999999999999999999999999999999 2348999999999 8888899999999976
Q ss_pred CC
Q 040274 177 SG 178 (359)
Q Consensus 177 ~~ 178 (359)
++
T Consensus 336 t~ 337 (430)
T KOG0640|consen 336 TG 337 (430)
T ss_pred CC
Confidence 54
No 92
>KOG0647 consensus mRNA export protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.80 E-value=7.7e-18 Score=142.48 Aligned_cols=126 Identities=13% Similarity=0.152 Sum_probs=105.4
Q ss_pred eEEEECCCCCEEEEecc--------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEe
Q 040274 52 ILWILPSSGRYMAVAGR--------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKM 105 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~--------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~ 105 (359)
.+|+|||....+++++. +|.+++|+.+|..+++|+.|+.+++||+.+++ +..+
T Consensus 31 S~l~FSP~~~~~~~A~SWD~tVR~wevq~~g~~~~ka~~~~~~PvL~v~WsddgskVf~g~~Dk~~k~wDL~S~Q-~~~v 109 (347)
T KOG0647|consen 31 SALAFSPQADNLLAAGSWDGTVRIWEVQNSGQLVPKAQQSHDGPVLDVCWSDDGSKVFSGGCDKQAKLWDLASGQ-VSQV 109 (347)
T ss_pred heeEeccccCceEEecccCCceEEEEEecCCcccchhhhccCCCeEEEEEccCCceEEeeccCCceEEEEccCCC-eeee
Confidence 88999995555554444 89999999999999999999999999999995 5667
Q ss_pred ecCCCCeEEEEEecCCC--EEEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCCcEEEEcCCcEEEEcCCCC
Q 040274 106 LYHQGPVSALAFHPNGH--LMATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKGLLAVGTGSFAQILGDFSG 178 (359)
Q Consensus 106 ~~h~~~v~~l~~~p~g~--~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~gl~~~~~d~~i~v~d~~~~ 178 (359)
..|.++|.++.|-+... .|+||+.|.+|+.||+|...++.++ +..+++++.-..-++.+..++.|.+|++.++
T Consensus 110 ~~Hd~pvkt~~wv~~~~~~cl~TGSWDKTlKfWD~R~~~pv~t~~LPeRvYa~Dv~~pm~vVata~r~i~vynL~n~ 186 (347)
T KOG0647|consen 110 AAHDAPVKTCHWVPGMNYQCLVTGSWDKTLKFWDTRSSNPVATLQLPERVYAADVLYPMAVVATAERHIAVYNLENP 186 (347)
T ss_pred eecccceeEEEEecCCCcceeEecccccceeecccCCCCeeeeeeccceeeehhccCceeEEEecCCcEEEEEcCCC
Confidence 79999999999987666 7999999999999999999888887 5667766654443666677889999998654
No 93
>KOG0302 consensus Ribosome Assembly protein [General function prediction only]
Probab=99.79 E-value=1.2e-18 Score=151.28 Aligned_cols=146 Identities=15% Similarity=0.276 Sum_probs=115.1
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCC--cceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC---Ce
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTS--ALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRK---YE 142 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~--~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~---~~ 142 (359)
.|-.|+||| ...+|++||.||+|+|||++.+ ++......|.+.|+.++|+....+||+|+.||+++|||+|. ++
T Consensus 259 SVEDLqWSptE~~vfaScS~DgsIrIWDiRs~~~~~~~~~kAh~sDVNVISWnr~~~lLasG~DdGt~~iwDLR~~~~~~ 338 (440)
T KOG0302|consen 259 SVEDLQWSPTEDGVFASCSCDGSIRIWDIRSGPKKAAVSTKAHNSDVNVISWNRREPLLASGGDDGTLSIWDLRQFKSGQ 338 (440)
T ss_pred chhhhccCCccCceEEeeecCceEEEEEecCCCccceeEeeccCCceeeEEccCCcceeeecCCCceEEEEEhhhccCCC
Confidence 899999999 5679999999999999999987 23334479999999999999888999999999999999996 45
Q ss_pred eeEee---cCCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCc---------------cccccccccCCCCcceeEEEE
Q 040274 143 VLQTL---TGHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSH---------------NYSRYMGNSMVKGYQIGKVSF 201 (359)
Q Consensus 143 ~~~~~---~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~---------------~~~~~~~~~~~~~~~v~~~~~ 201 (359)
++.+| ..+|+++.|+|.. ++++|.|+.|.|||+..... +...+.-|.+ ...|-.+.|
T Consensus 339 pVA~fk~Hk~pItsieW~p~e~s~iaasg~D~QitiWDlsvE~D~ee~~~~a~~~L~dlPpQLLFVHqG--Qke~KevhW 416 (440)
T KOG0302|consen 339 PVATFKYHKAPITSIEWHPHEDSVIAASGEDNQITIWDLSVEADEEEIDQEAAEGLQDLPPQLLFVHQG--QKEVKEVHW 416 (440)
T ss_pred cceeEEeccCCeeEEEeccccCceEEeccCCCcEEEEEeeccCChhhhccccccchhcCCceeEEEecc--hhHhhhhee
Confidence 66666 6789999999976 88888999999999754211 1123333432 124777899
Q ss_pred ccCC-CEEEEEeCCCe
Q 040274 202 RPYE-DVLGIGHSMGW 216 (359)
Q Consensus 202 sp~~-~~l~~g~~dg~ 216 (359)
++.- .+|++.+.||+
T Consensus 417 H~QiPG~lvsTa~dGf 432 (440)
T KOG0302|consen 417 HRQIPGLLVSTAIDGF 432 (440)
T ss_pred ccCCCCeEEEecccce
Confidence 9865 56777777775
No 94
>KOG1407 consensus WD40 repeat protein [Function unknown]
Probab=99.79 E-value=1.1e-17 Score=138.89 Aligned_cols=163 Identities=12% Similarity=0.190 Sum_probs=136.2
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCCcceEEe
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTSALLIKM 105 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~~~~~~ 105 (359)
.+++|.-+|..|++|+. .|-.++|+| ....|++++.|.+|++||+++++++...
T Consensus 24 ~Sv~wn~~g~~lasgs~dktv~v~n~e~~r~~~~~~~~gh~~svdql~w~~~~~d~~atas~dk~ir~wd~r~~k~~~~i 103 (313)
T KOG1407|consen 24 HSVAWNCDGTKLASGSFDKTVSVWNLERDRFRKELVYRGHTDSVDQLCWDPKHPDLFATASGDKTIRIWDIRSGKCTARI 103 (313)
T ss_pred eEEEEcccCceeeecccCCceEEEEecchhhhhhhcccCCCcchhhheeCCCCCcceEEecCCceEEEEEeccCcEEEEe
Confidence 89999999999999887 688899988 6679999999999999999999998887
Q ss_pred ecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCcc
Q 040274 106 LYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHN 181 (359)
Q Consensus 106 ~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~ 181 (359)
....+ -.-++|+|+|.+++.++.|..|.+.|.++.+.+... .-.+..++|+.++ ++.....|.|.|.... .-++
T Consensus 104 ~~~~e-ni~i~wsp~g~~~~~~~kdD~it~id~r~~~~~~~~~~~~e~ne~~w~~~nd~Fflt~GlG~v~ILsyp-sLkp 181 (313)
T KOG1407|consen 104 ETKGE-NINITWSPDGEYIAVGNKDDRITFIDARTYKIVNEEQFKFEVNEISWNNSNDLFFLTNGLGCVEILSYP-SLKP 181 (313)
T ss_pred eccCc-ceEEEEcCCCCEEEEecCcccEEEEEecccceeehhcccceeeeeeecCCCCEEEEecCCceEEEEecc-cccc
Confidence 65444 456889999999999999999999999998887776 4457888998777 4444455999998744 3356
Q ss_pred ccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEE
Q 040274 182 YSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGIL 220 (359)
Q Consensus 182 ~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~ 220 (359)
+..+..|.. ...|+.|+|+|+++|+|+.|..+++|
T Consensus 182 v~si~AH~s----nCicI~f~p~GryfA~GsADAlvSLW 216 (313)
T KOG1407|consen 182 VQSIKAHPS----NCICIEFDPDGRYFATGSADALVSLW 216 (313)
T ss_pred ccccccCCc----ceEEEEECCCCceEeeccccceeecc
Confidence 666777743 78999999999999999999988774
No 95
>KOG0313 consensus Microtubule binding protein YTM1 (contains WD40 repeats) [Cytoskeleton]
Probab=99.79 E-value=6.5e-18 Score=146.85 Aligned_cols=153 Identities=18% Similarity=0.262 Sum_probs=127.8
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCC-------------------------CCcceEEeecCCCCeEEEEEecCCCE
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPT-------------------------TSALLIKMLYHQGPVSALAFHPNGHL 123 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~-------------------------~~~~~~~~~~h~~~v~~l~~~p~g~~ 123 (359)
.|-+++.+++|..+++|+.|.+|.||+.. ++.++.++.+|..+|.++.|++ ...
T Consensus 195 ~V~sVsv~~sgtr~~SgS~D~~lkiWs~~~~~~~~~E~~s~~rrk~~~~~~~~~~r~P~vtl~GHt~~Vs~V~w~d-~~v 273 (423)
T KOG0313|consen 195 SVDSVSVDSSGTRFCSGSWDTMLKIWSVETDEEDELESSSNRRRKKQKREKEGGTRTPLVTLEGHTEPVSSVVWSD-ATV 273 (423)
T ss_pred ceeEEEecCCCCeEEeecccceeeecccCCCccccccccchhhhhhhhhhhcccccCceEEecccccceeeEEEcC-CCc
Confidence 89999999999999999999999999921 2347788899999999999988 568
Q ss_pred EEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCcc--ccccccccCCCCccee
Q 040274 124 MATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHN--YSRYMGNSMVKGYQIG 197 (359)
Q Consensus 124 l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~--~~~~~~~~~~~~~~v~ 197 (359)
+++++.|.+|++||+.++..+.++ ....+|++++|.. +++++.|..|++||.+.+... ...+.+|.. .|.
T Consensus 274 ~yS~SwDHTIk~WDletg~~~~~~~~~ksl~~i~~~~~~~Ll~~gssdr~irl~DPR~~~gs~v~~s~~gH~n----wVs 349 (423)
T KOG0313|consen 274 IYSVSWDHTIKVWDLETGGLKSTLTTNKSLNCISYSPLSKLLASGSSDRHIRLWDPRTGDGSVVSQSLIGHKN----WVS 349 (423)
T ss_pred eEeecccceEEEEEeecccceeeeecCcceeEeecccccceeeecCCCCceeecCCCCCCCceeEEeeecchh----hhh
Confidence 999999999999999999988877 4568999999987 777888999999998776432 345566644 999
Q ss_pred EEEEccCC-CEEEEEeCCCeEEEEEcCCCC
Q 040274 198 KVSFRPYE-DVLGIGHSMGWSGILVPRSSE 226 (359)
Q Consensus 198 ~~~~sp~~-~~l~~g~~dg~~~i~~~gs~~ 226 (359)
++.|+|.. ..|++|+.|+.+.+|..-+..
T Consensus 350 svkwsp~~~~~~~S~S~D~t~klWDvRS~k 379 (423)
T KOG0313|consen 350 SVKWSPTNEFQLVSGSYDNTVKLWDVRSTK 379 (423)
T ss_pred heecCCCCceEEEEEecCCeEEEEEeccCC
Confidence 99999976 557889999998887655444
No 96
>KOG0306 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.79 E-value=5.7e-18 Score=158.46 Aligned_cols=183 Identities=15% Similarity=0.247 Sum_probs=152.0
Q ss_pred eEEEECCCCCEEEEecc--------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCC
Q 040274 52 ILWILPSSGRYMAVAGR--------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGP 111 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~--------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~ 111 (359)
.++++|.|...+++|+. .+.|..|-|.+.++++|..+|.+.+||+.+...+-+..+|.+.
T Consensus 377 Rsl~vS~d~~~~~Sga~~SikiWn~~t~kciRTi~~~y~l~~~Fvpgd~~Iv~G~k~Gel~vfdlaS~~l~Eti~AHdga 456 (888)
T KOG0306|consen 377 RSLCVSSDSILLASGAGESIKIWNRDTLKCIRTITCGYILASKFVPGDRYIVLGTKNGELQVFDLASASLVETIRAHDGA 456 (888)
T ss_pred eEEEeecCceeeeecCCCcEEEEEccCcceeEEeccccEEEEEecCCCceEEEeccCCceEEEEeehhhhhhhhhccccc
Confidence 67788888888888754 6788999999999999999999999999999888888999999
Q ss_pred eEEEEEecCCCEEEEecCCCeEEEEEcCC-----Cee----------eEeecCCceeEEEcCCC-cEEEE-cCCcEEEEc
Q 040274 112 VSALAFHPNGHLMATTGKECKIKIWDLRK-----YEV----------LQTLTGHAKTLDFSQKG-LLAVG-TGSFAQILG 174 (359)
Q Consensus 112 v~~l~~~p~g~~l~s~~~d~~i~vwd~~~-----~~~----------~~~~~~~v~~~~~s~~g-l~~~~-~d~~i~v~d 174 (359)
+++++.+||+..++|||.|.+|++||..- +.. +..+...|.|+.+|||| +++++ -|++|.||-
T Consensus 457 IWsi~~~pD~~g~vT~saDktVkfWdf~l~~~~~gt~~k~lsl~~~rtLel~ddvL~v~~Spdgk~LaVsLLdnTVkVyf 536 (888)
T KOG0306|consen 457 IWSISLSPDNKGFVTGSADKTVKFWDFKLVVSVPGTQKKVLSLKHTRTLELEDDVLCVSVSPDGKLLAVSLLDNTVKVYF 536 (888)
T ss_pred eeeeeecCCCCceEEecCCcEEEEEeEEEEeccCcccceeeeeccceEEeccccEEEEEEcCCCcEEEEEeccCeEEEEE
Confidence 99999999999999999999999999742 111 11225679999999999 66666 699999997
Q ss_pred CCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE------------------------------EEcCC
Q 040274 175 DFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI------------------------------LVPRS 224 (359)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i------------------------------~~~gs 224 (359)
+.+- +..-.+.+|.. +|.|+..+||+..|++|+.|..+.| +.+.+
T Consensus 537 lDtl-KFflsLYGHkL----PV~smDIS~DSklivTgSADKnVKiWGLdFGDCHKS~fAHdDSvm~V~F~P~~~~FFt~g 611 (888)
T KOG0306|consen 537 LDTL-KFFLSLYGHKL----PVLSMDISPDSKLIVTGSADKNVKIWGLDFGDCHKSFFAHDDSVMSVQFLPKTHLFFTCG 611 (888)
T ss_pred ecce-eeeeeeccccc----ceeEEeccCCcCeEEeccCCCceEEeccccchhhhhhhcccCceeEEEEcccceeEEEec
Confidence 5443 55566678877 9999999999999999999999887 34555
Q ss_pred CCCceeeeccCCCCC
Q 040274 225 SEPNFDSWVANPFET 239 (359)
Q Consensus 225 ~~~~~~~~~~~~~~~ 239 (359)
-|+.++-|+...|+.
T Consensus 612 KD~kvKqWDg~kFe~ 626 (888)
T KOG0306|consen 612 KDGKVKQWDGEKFEE 626 (888)
T ss_pred CcceEEeechhhhhh
Confidence 677888888776655
No 97
>KOG0639 consensus Transducin-like enhancer of split protein (contains WD40 repeats) [Chromatin structure and dynamics]
Probab=99.79 E-value=7.3e-19 Score=157.64 Aligned_cols=162 Identities=19% Similarity=0.305 Sum_probs=138.3
Q ss_pred eEEEECCCCCEEEEecc---------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEE
Q 040274 52 ILWILPSSGRYMAVAGR---------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIK 104 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~---------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~ 104 (359)
..+.+|...+++.+||. .|.++.+.|||..|++|+.-.+|.|||+.+..+...
T Consensus 423 cAvtIS~~trhVyTgGkgcVKVWdis~pg~k~PvsqLdcl~rdnyiRSckL~pdgrtLivGGeastlsiWDLAapTprik 502 (705)
T KOG0639|consen 423 CAVTISNPTRHVYTGGKGCVKVWDISQPGNKSPVSQLDCLNRDNYIRSCKLLPDGRTLIVGGEASTLSIWDLAAPTPRIK 502 (705)
T ss_pred EEEEecCCcceeEecCCCeEEEeeccCCCCCCccccccccCcccceeeeEecCCCceEEeccccceeeeeeccCCCcchh
Confidence 67788999999999998 688899999999999999999999999987655433
Q ss_pred --eecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecCC---ceeEEEcCCC--cEEEEcCCcEEEEcCCC
Q 040274 105 --MLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTGH---AKTLDFSQKG--LLAVGTGSFAQILGDFS 177 (359)
Q Consensus 105 --~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~~---v~~~~~s~~g--l~~~~~d~~i~v~d~~~ 177 (359)
+....-.+++++.+||.++.++|+.||+|.|||+.+...++.|.++ +.||.++++| +.+++-|++|+.||++.
T Consensus 503 aeltssapaCyALa~spDakvcFsccsdGnI~vwDLhnq~~VrqfqGhtDGascIdis~dGtklWTGGlDntvRcWDlre 582 (705)
T KOG0639|consen 503 AELTSSAPACYALAISPDAKVCFSCCSDGNIAVWDLHNQTLVRQFQGHTDGASCIDISKDGTKLWTGGLDNTVRCWDLRE 582 (705)
T ss_pred hhcCCcchhhhhhhcCCccceeeeeccCCcEEEEEcccceeeecccCCCCCceeEEecCCCceeecCCCccceeehhhhh
Confidence 3333456788999999999999999999999999999999999665 7999999999 99999999999999876
Q ss_pred CCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 178 GSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 178 ~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
+... ..|. ..+.|.++.++|+++||++|-.++.+.|
T Consensus 583 grql----qqhd--F~SQIfSLg~cP~~dWlavGMens~vev 618 (705)
T KOG0639|consen 583 GRQL----QQHD--FSSQIFSLGYCPTGDWLAVGMENSNVEV 618 (705)
T ss_pred hhhh----hhhh--hhhhheecccCCCccceeeecccCcEEE
Confidence 6332 3332 3347999999999999999999998776
No 98
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.79 E-value=5e-18 Score=139.02 Aligned_cols=147 Identities=18% Similarity=0.215 Sum_probs=127.2
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
+|.++.|+-+|+|.++++.|.+|++|++-.+.++.++.+|...|..++.+.|...|++|+.|..|.+||+.+|+.++.+.
T Consensus 19 aV~avryN~dGnY~ltcGsdrtvrLWNp~rg~liktYsghG~EVlD~~~s~Dnskf~s~GgDk~v~vwDV~TGkv~Rr~r 98 (307)
T KOG0316|consen 19 AVRAVRYNVDGNYCLTCGSDRTVRLWNPLRGALIKTYSGHGHEVLDAALSSDNSKFASCGGDKAVQVWDVNTGKVDRRFR 98 (307)
T ss_pred ceEEEEEccCCCEEEEcCCCceEEeecccccceeeeecCCCceeeeccccccccccccCCCCceEEEEEcccCeeeeecc
Confidence 89999999999999999999999999999999999999999999999999999999999999999999999999999996
Q ss_pred CC---ceeEEEcCCC--cEEEEcCCcEEEEcCCCCC-ccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 149 GH---AKTLDFSQKG--LLAVGTGSFAQILGDFSGS-HNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 149 ~~---v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~-~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
+| |+.+.|+.+. +++++.|.++++||-+... ++++.+.... ..|.++..+ +..|+.|+.||.++.|.
T Consensus 99 gH~aqVNtV~fNeesSVv~SgsfD~s~r~wDCRS~s~ePiQildea~----D~V~Si~v~--~heIvaGS~DGtvRtyd 171 (307)
T KOG0316|consen 99 GHLAQVNTVRFNEESSVVASGSFDSSVRLWDCRSRSFEPIQILDEAK----DGVSSIDVA--EHEIVAGSVDGTVRTYD 171 (307)
T ss_pred cccceeeEEEecCcceEEEeccccceeEEEEcccCCCCccchhhhhc----CceeEEEec--ccEEEeeccCCcEEEEE
Confidence 65 8999999988 8888999999999976542 3333333332 268888874 55788999999887753
No 99
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=99.79 E-value=3e-17 Score=139.32 Aligned_cols=163 Identities=15% Similarity=0.107 Sum_probs=128.3
Q ss_pred eEEEECCCCCEEEEecc----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCC
Q 040274 52 ILWILPSSGRYMAVAGR----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQ 109 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~ 109 (359)
.++.|+|.+..|+.++. ++.+++|.++ ..+++|+.||.|+++|++++.. ..+..|.
T Consensus 17 S~v~f~~~~~~LLvssWDgslrlYdv~~~~l~~~~~~~~plL~c~F~d~-~~~~~G~~dg~vr~~Dln~~~~-~~igth~ 94 (323)
T KOG1036|consen 17 SSVKFSPSSSDLLVSSWDGSLRLYDVPANSLKLKFKHGAPLLDCAFADE-STIVTGGLDGQVRRYDLNTGNE-DQIGTHD 94 (323)
T ss_pred eeEEEcCcCCcEEEEeccCcEEEEeccchhhhhheecCCceeeeeccCC-ceEEEeccCceEEEEEecCCcc-eeeccCC
Confidence 78888888777776665 8999999884 4788999999999999998764 4455899
Q ss_pred CCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCCcEEEEcCCcEEEEcCCCCCcccccccc
Q 040274 110 GPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYMG 187 (359)
Q Consensus 110 ~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~~ 187 (359)
.+|.|+.+++....+++||.|++|++||.+......++ ...|.++..+.+-|+.++.+..+.+||+++..........
T Consensus 95 ~~i~ci~~~~~~~~vIsgsWD~~ik~wD~R~~~~~~~~d~~kkVy~~~v~g~~LvVg~~~r~v~iyDLRn~~~~~q~reS 174 (323)
T KOG1036|consen 95 EGIRCIEYSYEVGCVISGSWDKTIKFWDPRNKVVVGTFDQGKKVYCMDVSGNRLVVGTSDRKVLIYDLRNLDEPFQRRES 174 (323)
T ss_pred CceEEEEeeccCCeEEEcccCccEEEEeccccccccccccCceEEEEeccCCEEEEeecCceEEEEEcccccchhhhccc
Confidence 99999999998889999999999999999975555555 4468888877666888999999999998876444322222
Q ss_pred ccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 188 NSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 188 ~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
. ....+.|+++-|++.-.++++-+|.+.+
T Consensus 175 ~---lkyqtR~v~~~pn~eGy~~sSieGRVav 203 (323)
T KOG1036|consen 175 S---LKYQTRCVALVPNGEGYVVSSIEGRVAV 203 (323)
T ss_pred c---ceeEEEEEEEecCCCceEEEeecceEEE
Confidence 1 3346777888887777777777776555
No 100
>KOG0264 consensus Nucleosome remodeling factor, subunit CAF1/NURF55/MSI1 [Chromatin structure and dynamics]
Probab=99.79 E-value=2.5e-18 Score=152.61 Aligned_cols=151 Identities=16% Similarity=0.242 Sum_probs=124.8
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCC-------cceEEeecCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcC
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTS-------ALLIKMLYHQGPVSALAFHP-NGHLMATTGKECKIKIWDLR 139 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~-------~~~~~~~~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~ 139 (359)
.-.+|+|++ ....|++|+.|++|++||+... .+...+.+|...|..++|+| +..+|++++.|+.+.|||+|
T Consensus 179 eg~glsWn~~~~g~Lls~~~d~~i~lwdi~~~~~~~~~~~p~~~~~~h~~~VeDV~~h~~h~~lF~sv~dd~~L~iwD~R 258 (422)
T KOG0264|consen 179 EGYGLSWNRQQEGTLLSGSDDHTICLWDINAESKEDKVVDPKTIFSGHEDVVEDVAWHPLHEDLFGSVGDDGKLMIWDTR 258 (422)
T ss_pred cccccccccccceeEeeccCCCcEEEEeccccccCCccccceEEeecCCcceehhhccccchhhheeecCCCeEEEEEcC
Confidence 367899999 4568999999999999998743 24566789999999999999 56789999999999999999
Q ss_pred C--CeeeEee---cCCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCC-CEEEE
Q 040274 140 K--YEVLQTL---TGHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYE-DVLGI 210 (359)
Q Consensus 140 ~--~~~~~~~---~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~-~~l~~ 210 (359)
+ .++.... .+.++|++|+|-+ ++++|.|++|.+||+++....+..+.+|.. .|.++.|+|+. .+|++
T Consensus 259 ~~~~~~~~~~~ah~~~vn~~~fnp~~~~ilAT~S~D~tV~LwDlRnL~~~lh~~e~H~d----ev~~V~WSPh~etvLAS 334 (422)
T KOG0264|consen 259 SNTSKPSHSVKAHSAEVNCVAFNPFNEFILATGSADKTVALWDLRNLNKPLHTFEGHED----EVFQVEWSPHNETVLAS 334 (422)
T ss_pred CCCCCCcccccccCCceeEEEeCCCCCceEEeccCCCcEEEeechhcccCceeccCCCc----ceEEEEeCCCCCceeEe
Confidence 5 3333333 4669999999987 667778999999999888777777777765 89999999965 78899
Q ss_pred EeCCCeEEEEEcC
Q 040274 211 GHSMGWSGILVPR 223 (359)
Q Consensus 211 g~~dg~~~i~~~g 223 (359)
++.|+.+.+|...
T Consensus 335 Sg~D~rl~vWDls 347 (422)
T KOG0264|consen 335 SGTDRRLNVWDLS 347 (422)
T ss_pred cccCCcEEEEecc
Confidence 9999998887543
No 101
>KOG0643 consensus Translation initiation factor 3, subunit i (eIF-3i)/TGF-beta receptor-interacting protein (TRIP-1) [Translation, ribosomal structure and biogenesis; Signal transduction mechanisms]
Probab=99.78 E-value=1.4e-17 Score=138.71 Aligned_cols=167 Identities=14% Similarity=0.183 Sum_probs=140.2
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h 108 (359)
..+.+..+|.+|.+|+. .|+|++.+.+...+++|+.|.++++||+.+|+.+..+..
T Consensus 14 TqiKyN~eGDLlFscaKD~~~~vw~s~nGerlGty~GHtGavW~~Did~~s~~liTGSAD~t~kLWDv~tGk~la~~k~- 92 (327)
T KOG0643|consen 14 TQIKYNREGDLLFSCAKDSTPTVWYSLNGERLGTYDGHTGAVWCCDIDWDSKHLITGSADQTAKLWDVETGKQLATWKT- 92 (327)
T ss_pred ceEEecCCCcEEEEecCCCCceEEEecCCceeeeecCCCceEEEEEecCCcceeeeccccceeEEEEcCCCcEEEEeec-
Confidence 67788889998888886 899999999999999999999999999999999988864
Q ss_pred CCCeEEEEEecCCCEEEEecC-----CCeEEEEEcCC-------CeeeEee---cCCceeEEEcCCC--cEEEEcCCcEE
Q 040274 109 QGPVSALAFHPNGHLMATTGK-----ECKIKIWDLRK-------YEVLQTL---TGHAKTLDFSQKG--LLAVGTGSFAQ 171 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~-----d~~i~vwd~~~-------~~~~~~~---~~~v~~~~~s~~g--l~~~~~d~~i~ 171 (359)
..+|..+.|+++|++++.+.. .+.|.++|++. .+++..+ ...++.+-|+|-+ +++|..+|.|.
T Consensus 93 ~~~Vk~~~F~~~gn~~l~~tD~~mg~~~~v~~fdi~~~~~~~~s~ep~~kI~t~~skit~a~Wg~l~~~ii~Ghe~G~is 172 (327)
T KOG0643|consen 93 NSPVKRVDFSFGGNLILASTDKQMGYTCFVSVFDIRDDSSDIDSEEPYLKIPTPDSKITSALWGPLGETIIAGHEDGSIS 172 (327)
T ss_pred CCeeEEEeeccCCcEEEEEehhhcCcceEEEEEEccCChhhhcccCceEEecCCccceeeeeecccCCEEEEecCCCcEE
Confidence 778999999999998777654 36799999983 4456655 3568999999999 88899999999
Q ss_pred EEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 172 ILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 172 v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
+||..++...+.....|.. .|+.+.|+||..++++|+.|....+|...
T Consensus 173 ~~da~~g~~~v~s~~~h~~----~Ind~q~s~d~T~FiT~s~Dttakl~D~~ 220 (327)
T KOG0643|consen 173 IYDARTGKELVDSDEEHSS----KINDLQFSRDRTYFITGSKDTTAKLVDVR 220 (327)
T ss_pred EEEcccCceeeechhhhcc----ccccccccCCcceEEecccCccceeeecc
Confidence 9998877666665555543 89999999999999999988876666543
No 102
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.78 E-value=7.1e-18 Score=150.89 Aligned_cols=164 Identities=15% Similarity=0.236 Sum_probs=132.9
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCC-CEEEEecCCCeEEEEEcCCCeeeEee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNG-HLMATTGKECKIKIWDLRKYEVLQTL 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g-~~l~s~~~d~~i~vwd~~~~~~~~~~ 147 (359)
.|.+++|-.||.++++|+..|.|+|||..+...+..+.+|+.+|..+.|+|++ ..|++|+.|+.+++||+.+......+
T Consensus 70 ~v~s~~fR~DG~LlaaGD~sG~V~vfD~k~r~iLR~~~ah~apv~~~~f~~~d~t~l~s~sDd~v~k~~d~s~a~v~~~l 149 (487)
T KOG0310|consen 70 VVYSVDFRSDGRLLAAGDESGHVKVFDMKSRVILRQLYAHQAPVHVTKFSPQDNTMLVSGSDDKVVKYWDLSTAYVQAEL 149 (487)
T ss_pred ceeEEEeecCCeEEEccCCcCcEEEeccccHHHHHHHhhccCceeEEEecccCCeEEEecCCCceEEEEEcCCcEEEEEe
Confidence 79999999999999999999999999988777888899999999999999955 55778888999999999988765455
Q ss_pred c---CCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE--
Q 040274 148 T---GHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI-- 219 (359)
Q Consensus 148 ~---~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i-- 219 (359)
. +.|.|.+|+|-. +++||+||.|++||++.....+ .-.. |+.+|.++.|-|.|..+++++.+.. .+
T Consensus 150 ~~htDYVR~g~~~~~~~hivvtGsYDg~vrl~DtR~~~~~v-~eln----hg~pVe~vl~lpsgs~iasAgGn~v-kVWD 223 (487)
T KOG0310|consen 150 SGHTDYVRCGDISPANDHIVVTGSYDGKVRLWDTRSLTSRV-VELN----HGCPVESVLALPSGSLIASAGGNSV-KVWD 223 (487)
T ss_pred cCCcceeEeeccccCCCeEEEecCCCceEEEEEeccCCcee-EEec----CCCceeeEEEcCCCCEEEEcCCCeE-EEEE
Confidence 4 458999999965 8899999999999976653222 2223 4459999999999999998876643 33
Q ss_pred -----------------------------EEcCCCCCceeeeccCCCC
Q 040274 220 -----------------------------LVPRSSEPNFDSWVANPFE 238 (359)
Q Consensus 220 -----------------------------~~~gs~~~~~~~~~~~~~~ 238 (359)
+++++-|+.+++|+...|.
T Consensus 224 l~~G~qll~~~~~H~KtVTcL~l~s~~~rLlS~sLD~~VKVfd~t~~K 271 (487)
T KOG0310|consen 224 LTTGGQLLTSMFNHNKTVTCLRLASDSTRLLSGSLDRHVKVFDTTNYK 271 (487)
T ss_pred ecCCceehhhhhcccceEEEEEeecCCceEeecccccceEEEEccceE
Confidence 4566777888888765543
No 103
>KOG0288 consensus WD40 repeat protein TipD [General function prediction only]
Probab=99.78 E-value=4.1e-18 Score=149.54 Aligned_cols=173 Identities=17% Similarity=0.223 Sum_probs=134.4
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML 106 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~ 106 (359)
.++.|-++...|++||. .|+++.|.+++.++++++.|+.+++|+++..+...++.
T Consensus 179 ~~v~~l~~sdtlatgg~Dr~Ik~W~v~~~k~~~~~tLaGs~g~it~~d~d~~~~~~iAas~d~~~r~Wnvd~~r~~~TLs 258 (459)
T KOG0288|consen 179 HDVEFLRNSDTLATGGSDRIIKLWNVLGEKSELISTLAGSLGNITSIDFDSDNKHVIAASNDKNLRLWNVDSLRLRHTLS 258 (459)
T ss_pred ceeEEccCcchhhhcchhhhhhhhhcccchhhhhhhhhccCCCcceeeecCCCceEEeecCCCceeeeeccchhhhhhhc
Confidence 77788888888999887 69999999999999999999999999999999999999
Q ss_pred cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC---------------------------------------CeeeEee
Q 040274 107 YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRK---------------------------------------YEVLQTL 147 (359)
Q Consensus 107 ~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~---------------------------------------~~~~~~~ 147 (359)
+|++.|+++.|.-....+++|+.|.+|++||+.. ..++.+.
T Consensus 259 GHtdkVt~ak~~~~~~~vVsgs~DRtiK~WDl~k~~C~kt~l~~S~cnDI~~~~~~~~SgH~DkkvRfwD~Rs~~~~~sv 338 (459)
T KOG0288|consen 259 GHTDKVTAAKFKLSHSRVVSGSADRTIKLWDLQKAYCSKTVLPGSQCNDIVCSISDVISGHFDKKVRFWDIRSADKTRSV 338 (459)
T ss_pred ccccceeeehhhccccceeeccccchhhhhhhhhhheeccccccccccceEecceeeeecccccceEEEeccCCceeeEe
Confidence 9999999998876555466666666666666543 3333333
Q ss_pred --cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 148 --TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 148 --~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
.+.|+++..+++| +++++.|.++.++|+++. ....++.......+..++.+.|||++.|+++|+.||.+.||...
T Consensus 339 ~~gg~vtSl~ls~~g~~lLsssRDdtl~viDlRt~-eI~~~~sA~g~k~asDwtrvvfSpd~~YvaAGS~dgsv~iW~v~ 417 (459)
T KOG0288|consen 339 PLGGRVTSLDLSMDGLELLSSSRDDTLKVIDLRTK-EIRQTFSAEGFKCASDWTRVVFSPDGSYVAAGSADGSVYIWSVF 417 (459)
T ss_pred ecCcceeeEeeccCCeEEeeecCCCceeeeecccc-cEEEEeeccccccccccceeEECCCCceeeeccCCCcEEEEEcc
Confidence 2346788888888 778888888888886554 44444443322234468899999999999999999998888765
Q ss_pred CC
Q 040274 224 SS 225 (359)
Q Consensus 224 s~ 225 (359)
++
T Consensus 418 tg 419 (459)
T KOG0288|consen 418 TG 419 (459)
T ss_pred Cc
Confidence 54
No 104
>KOG0267 consensus Microtubule severing protein katanin p80 subunit B (contains WD40 repeats) [Cell cycle control, cell division, chromosome partitioning]
Probab=99.77 E-value=3.6e-19 Score=165.79 Aligned_cols=148 Identities=20% Similarity=0.375 Sum_probs=133.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
+|-|+.|+++..+|++|+.+|+|++||+...+.+.++.||...+.++.|+|-+.|+++++.|+.+++||++...|.+.+.
T Consensus 72 pIeSl~f~~~E~LlaagsasgtiK~wDleeAk~vrtLtgh~~~~~sv~f~P~~~~~a~gStdtd~~iwD~Rk~Gc~~~~~ 151 (825)
T KOG0267|consen 72 PIESLTFDTSERLLAAGSASGTIKVWDLEEAKIVRTLTGHLLNITSVDFHPYGEFFASGSTDTDLKIWDIRKKGCSHTYK 151 (825)
T ss_pred cceeeecCcchhhhcccccCCceeeeehhhhhhhhhhhccccCcceeeeccceEEeccccccccceehhhhccCceeeec
Confidence 89999999999999999999999999999999999999999999999999999999999999999999999888999996
Q ss_pred CC---ceeEEEcCCC-cE-EEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 149 GH---AKTLDFSQKG-LL-AVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 149 ~~---v~~~~~s~~g-l~-~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
++ +.++.|+|+| ++ .++.|.++.|||... +.....|..|.+ .+.++.|+|..-.+++|+.|+++++|.
T Consensus 152 s~~~vv~~l~lsP~Gr~v~~g~ed~tvki~d~~a-gk~~~ef~~~e~----~v~sle~hp~e~Lla~Gs~d~tv~f~d 224 (825)
T KOG0267|consen 152 SHTRVVDVLRLSPDGRWVASGGEDNTVKIWDLTA-GKLSKEFKSHEG----KVQSLEFHPLEVLLAPGSSDRTVRFWD 224 (825)
T ss_pred CCcceeEEEeecCCCceeeccCCcceeeeecccc-cccccccccccc----cccccccCchhhhhccCCCCceeeeec
Confidence 65 5788999999 54 455669999999544 477778888866 899999999999999999999998874
No 105
>KOG0646 consensus WD40 repeat protein [General function prediction only]
Probab=99.77 E-value=1.1e-17 Score=149.04 Aligned_cols=164 Identities=18% Similarity=0.252 Sum_probs=139.0
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC--------
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRK-------- 140 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~-------- 140 (359)
.|+|++-+|+|.+++.|.-.|.+++|.+.+|..+..+.+|-..|+|+.|+-||.+|+|||.||.|.+|++..
T Consensus 83 ~v~al~s~n~G~~l~ag~i~g~lYlWelssG~LL~v~~aHYQ~ITcL~fs~dgs~iiTgskDg~V~vW~l~~lv~a~~~~ 162 (476)
T KOG0646|consen 83 PVHALASSNLGYFLLAGTISGNLYLWELSSGILLNVLSAHYQSITCLKFSDDGSHIITGSKDGAVLVWLLTDLVSADNDH 162 (476)
T ss_pred ceeeeecCCCceEEEeecccCcEEEEEeccccHHHHHHhhccceeEEEEeCCCcEEEecCCCccEEEEEEEeecccccCC
Confidence 699999999999999998999999999999999999999999999999999999999999999999998642
Q ss_pred -CeeeEeecCC---ceeEEEcCCC----cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEe
Q 040274 141 -YEVLQTLTGH---AKTLDFSQKG----LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGH 212 (359)
Q Consensus 141 -~~~~~~~~~~---v~~~~~s~~g----l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~ 212 (359)
-.+++.|.+| |+++...+.| ++++|.|.++++||+..+ ..+..+... ..+.+++.+|-++.+++|+
T Consensus 163 ~~~p~~~f~~HtlsITDl~ig~Gg~~~rl~TaS~D~t~k~wdlS~g-~LLlti~fp-----~si~av~lDpae~~~yiGt 236 (476)
T KOG0646|consen 163 SVKPLHIFSDHTLSITDLQIGSGGTNARLYTASEDRTIKLWDLSLG-VLLLTITFP-----SSIKAVALDPAERVVYIGT 236 (476)
T ss_pred CccceeeeccCcceeEEEEecCCCccceEEEecCCceEEEEEeccc-eeeEEEecC-----CcceeEEEcccccEEEecC
Confidence 3456667544 7888887765 899999999999997655 343333333 2699999999999999999
Q ss_pred CCCeEEE------------------------------------------------EEcCCCCCceeeeccCCCC
Q 040274 213 SMGWSGI------------------------------------------------LVPRSSEPNFDSWVANPFE 238 (359)
Q Consensus 213 ~dg~~~i------------------------------------------------~~~gs~~~~~~~~~~~~~~ 238 (359)
.+|.+.+ +++|+.|+.+.+|+....+
T Consensus 237 ~~G~I~~~~~~~~~~~~~~v~~k~~~~~~t~~~~~~Gh~~~~~ITcLais~DgtlLlSGd~dg~VcvWdi~S~Q 310 (476)
T KOG0646|consen 237 EEGKIFQNLLFKLSGQSAGVNQKGRHEENTQINVLVGHENESAITCLAISTDGTLLLSGDEDGKVCVWDIYSKQ 310 (476)
T ss_pred CcceEEeeehhcCCcccccccccccccccceeeeeccccCCcceeEEEEecCccEEEeeCCCCCEEEEecchHH
Confidence 9997654 7889999999999975433
No 106
>KOG0308 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.77 E-value=2.7e-18 Score=158.27 Aligned_cols=167 Identities=19% Similarity=0.244 Sum_probs=139.3
Q ss_pred eEEEEC-CCCCEEEEecc-----------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCC--
Q 040274 52 ILWILP-SSGRYMAVAGR-----------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTS-- 99 (359)
Q Consensus 52 ~~l~~s-pdg~~l~~~~~-----------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~-- 99 (359)
+.+..+ |+++||++||+ .|+.+....+++.|+++|.|-+|.+|+...+
T Consensus 28 ~~Lq~da~~~ryLfTgGRDg~i~~W~~~~d~~~~s~~~~asme~HsDWVNDiiL~~~~~tlIS~SsDtTVK~W~~~~~~~ 107 (735)
T KOG0308|consen 28 KALQLDAPNGRYLFTGGRDGIIRLWSVTQDSNEPSTPYIASMEHHSDWVNDIILCGNGKTLISASSDTTVKVWNAHKDNT 107 (735)
T ss_pred hhccccCCCCceEEecCCCceEEEeccccccCCcccchhhhhhhhHhHHhhHHhhcCCCceEEecCCceEEEeecccCcc
Confidence 344444 67888999998 6788888888889999999999999999877
Q ss_pred cceEEeecCCCCeEEEEE-ecCCCEEEEecCCCeEEEEEcCCC--eeeEee------------cCCceeEEEcCCC--cE
Q 040274 100 ALLIKMLYHQGPVSALAF-HPNGHLMATTGKECKIKIWDLRKY--EVLQTL------------TGHAKTLDFSQKG--LL 162 (359)
Q Consensus 100 ~~~~~~~~h~~~v~~l~~-~p~g~~l~s~~~d~~i~vwd~~~~--~~~~~~------------~~~v~~~~~s~~g--l~ 162 (359)
-++.++..|.+.|.|+++ .++..++|+||.|+.|.+||+.++ +.+.++ ..++++++-++.| ++
T Consensus 108 ~c~stir~H~DYVkcla~~ak~~~lvaSgGLD~~IflWDin~~~~~l~~s~n~~t~~sl~sG~k~siYSLA~N~t~t~iv 187 (735)
T KOG0308|consen 108 FCMSTIRTHKDYVKCLAYIAKNNELVASGGLDRKIFLWDINTGTATLVASFNNVTVNSLGSGPKDSIYSLAMNQTGTIIV 187 (735)
T ss_pred hhHhhhhcccchheeeeecccCceeEEecCCCccEEEEEccCcchhhhhhccccccccCCCCCccceeeeecCCcceEEE
Confidence 577788899999999999 788889999999999999999987 233333 1347899999999 77
Q ss_pred EEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 163 AVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 163 ~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
+|+..+.+++||.++. ..+..+.+|.. .|.++..++||..++++++||+|++|.-|
T Consensus 188 sGgtek~lr~wDprt~-~kimkLrGHTd----NVr~ll~~dDGt~~ls~sSDgtIrlWdLg 243 (735)
T KOG0308|consen 188 SGGTEKDLRLWDPRTC-KKIMKLRGHTD----NVRVLLVNDDGTRLLSASSDGTIRLWDLG 243 (735)
T ss_pred ecCcccceEEeccccc-cceeeeecccc----ceEEEEEcCCCCeEeecCCCceEEeeecc
Confidence 8888999999997665 55556667765 79999999999999999999999986443
No 107
>KOG0288 consensus WD40 repeat protein TipD [General function prediction only]
Probab=99.76 E-value=2.5e-17 Score=144.68 Aligned_cols=146 Identities=18% Similarity=0.190 Sum_probs=119.0
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
.|+.|..+ ...+++|+.|+.|++||+++..+......|. .|+++..+++|..|.+++.|.++.+.|+++.+..+.+.
T Consensus 304 ~cnDI~~~--~~~~~SgH~DkkvRfwD~Rs~~~~~sv~~gg-~vtSl~ls~~g~~lLsssRDdtl~viDlRt~eI~~~~s 380 (459)
T KOG0288|consen 304 QCNDIVCS--ISDVISGHFDKKVRFWDIRSADKTRSVPLGG-RVTSLDLSMDGLELLSSSRDDTLKVIDLRTKEIRQTFS 380 (459)
T ss_pred cccceEec--ceeeeecccccceEEEeccCCceeeEeecCc-ceeeEeeccCCeEEeeecCCCceeeeecccccEEEEee
Confidence 44445444 4467889999999999999999888887755 89999999999999999999999999999998888872
Q ss_pred -------CCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 149 -------GHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 149 -------~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
...+.+.|||++ +++||.||.|+||++.++ +....+..... ...|++++|+|.|..|++++.++.+.+
T Consensus 381 A~g~k~asDwtrvvfSpd~~YvaAGS~dgsv~iW~v~tg-KlE~~l~~s~s--~~aI~s~~W~~sG~~Llsadk~~~v~l 457 (459)
T KOG0288|consen 381 AEGFKCASDWTRVVFSPDGSYVAAGSADGSVYIWSVFTG-KLEKVLSLSTS--NAAITSLSWNPSGSGLLSADKQKAVTL 457 (459)
T ss_pred ccccccccccceeEECCCCceeeeccCCCcEEEEEccCc-eEEEEeccCCC--CcceEEEEEcCCCchhhcccCCcceEe
Confidence 236889999999 667888999999996554 44444433321 225999999999999999999998887
Q ss_pred E
Q 040274 220 L 220 (359)
Q Consensus 220 ~ 220 (359)
|
T Consensus 458 W 458 (459)
T KOG0288|consen 458 W 458 (459)
T ss_pred c
Confidence 7
No 108
>KOG0302 consensus Ribosome Assembly protein [General function prediction only]
Probab=99.76 E-value=1.8e-17 Score=144.06 Aligned_cols=149 Identities=17% Similarity=0.261 Sum_probs=114.6
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCCcce---EEeecCCCCeEEEEEecCC-CEEEEecCCCeEEEEEcCCC--
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTSALL---IKMLYHQGPVSALAFHPNG-HLMATTGKECKIKIWDLRKY-- 141 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~~~---~~~~~h~~~v~~l~~~p~g-~~l~s~~~d~~i~vwd~~~~-- 141 (359)
.-..|+||| ....|++|..-+.|++|.+.++... ..|.+|+..|-.|+|||.. ..|++||.||+|+|||+|.+
T Consensus 213 EGy~LdWSp~~~g~LlsGDc~~~I~lw~~~~g~W~vd~~Pf~gH~~SVEDLqWSptE~~vfaScS~DgsIrIWDiRs~~~ 292 (440)
T KOG0302|consen 213 EGYGLDWSPIKTGRLLSGDCVKGIHLWEPSTGSWKVDQRPFTGHTKSVEDLQWSPTEDGVFASCSCDGSIRIWDIRSGPK 292 (440)
T ss_pred cceeeecccccccccccCccccceEeeeeccCceeecCccccccccchhhhccCCccCceEEeeecCceEEEEEecCCCc
Confidence 457899999 3446889988899999999887543 3466899999999999954 57899999999999999987
Q ss_pred -eeeEee--cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCC--CccccccccccCCCCcceeEEEEccCC-CEEEEEeC
Q 040274 142 -EVLQTL--TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSG--SHNYSRYMGNSMVKGYQIGKVSFRPYE-DVLGIGHS 213 (359)
Q Consensus 142 -~~~~~~--~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~--~~~~~~~~~~~~~~~~~v~~~~~sp~~-~~l~~g~~ 213 (359)
.++.+- .+.|+.|.|+.+- |++|+.+|++.|||++.- +.++..+..|.. +|+|+.|+|.. ..|++++.
T Consensus 293 ~~~~~~kAh~sDVNVISWnr~~~lLasG~DdGt~~iwDLR~~~~~~pVA~fk~Hk~----pItsieW~p~e~s~iaasg~ 368 (440)
T KOG0302|consen 293 KAAVSTKAHNSDVNVISWNRREPLLASGGDDGTLSIWDLRQFKSGQPVATFKYHKA----PITSIEWHPHEDSVIAASGE 368 (440)
T ss_pred cceeEeeccCCceeeEEccCCcceeeecCCCceEEEEEhhhccCCCcceeEEeccC----CeeEEEeccccCceEEeccC
Confidence 333332 5679999999887 666777899999998653 344556666654 99999999965 55666666
Q ss_pred CCeEEEEE
Q 040274 214 MGWSGILV 221 (359)
Q Consensus 214 dg~~~i~~ 221 (359)
|..+.||.
T Consensus 369 D~QitiWD 376 (440)
T KOG0302|consen 369 DNQITIWD 376 (440)
T ss_pred CCcEEEEE
Confidence 66555554
No 109
>KOG1446 consensus Histone H3 (Lys4) methyltransferase complex and RNA cleavage factor II complex, subunit SWD2 [RNA processing and modification; Chromatin structure and dynamics; Posttranslational modification, protein turnover, chaperones]
Probab=99.75 E-value=2e-16 Score=134.83 Aligned_cols=160 Identities=22% Similarity=0.301 Sum_probs=126.4
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCC--eeeEe
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKY--EVLQT 146 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~--~~~~~ 146 (359)
.|++|+.+|-+..+++++.|++|++||+++.++...+..... ..++|+|+|-++|++.....|++||+|+. .+..+
T Consensus 102 ~V~sL~~sP~~d~FlS~S~D~tvrLWDlR~~~cqg~l~~~~~--pi~AfDp~GLifA~~~~~~~IkLyD~Rs~dkgPF~t 179 (311)
T KOG1446|consen 102 RVNSLSVSPKDDTFLSSSLDKTVRLWDLRVKKCQGLLNLSGR--PIAAFDPEGLIFALANGSELIKLYDLRSFDKGPFTT 179 (311)
T ss_pred eEEEEEecCCCCeEEecccCCeEEeeEecCCCCceEEecCCC--cceeECCCCcEEEEecCCCeEEEEEecccCCCCcee
Confidence 899999999889999999999999999998888777654333 45789999999999988889999999974 35555
Q ss_pred e--c----CCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEE
Q 040274 147 L--T----GHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSG 218 (359)
Q Consensus 147 ~--~----~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~ 218 (359)
+ . ...+.+.|||+| ++.+...+.+++.|...+ .....+..+.. .+..-.+.+|+||+.++++|+.||.+.
T Consensus 180 f~i~~~~~~ew~~l~FS~dGK~iLlsT~~s~~~~lDAf~G-~~~~tfs~~~~-~~~~~~~a~ftPds~Fvl~gs~dg~i~ 257 (311)
T KOG1446|consen 180 FSITDNDEAEWTDLEFSPDGKSILLSTNASFIYLLDAFDG-TVKSTFSGYPN-AGNLPLSATFTPDSKFVLSGSDDGTIH 257 (311)
T ss_pred EccCCCCccceeeeEEcCCCCEEEEEeCCCcEEEEEccCC-cEeeeEeeccC-CCCcceeEEECCCCcEEEEecCCCcEE
Confidence 5 1 236899999999 777777889999995544 56666666644 222336789999999999999999999
Q ss_pred EEEcCCCCCceeeec
Q 040274 219 ILVPRSSEPNFDSWV 233 (359)
Q Consensus 219 i~~~gs~~~~~~~~~ 233 (359)
+|.-.++.. +-.|.
T Consensus 258 vw~~~tg~~-v~~~~ 271 (311)
T KOG1446|consen 258 VWNLETGKK-VAVLR 271 (311)
T ss_pred EEEcCCCcE-eeEec
Confidence 998754433 34444
No 110
>KOG0294 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.75 E-value=1.7e-16 Score=135.18 Aligned_cols=164 Identities=20% Similarity=0.359 Sum_probs=120.8
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCC--EEEEEeCCCeEEEEeCCCCcceEEee
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNG--VVSLGHSGGTVTMWKPTTSALLIKML 106 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~--~l~tg~~dg~v~lwd~~~~~~~~~~~ 106 (359)
.++++ +|.|+++|+. .|+++.|.+.-. .|++|+.||.|.+|+......+.++.
T Consensus 47 tavAV--s~~~~aSGssDetI~IYDm~k~~qlg~ll~HagsitaL~F~~~~S~shLlS~sdDG~i~iw~~~~W~~~~slK 124 (362)
T KOG0294|consen 47 TALAV--SGPYVASGSSDETIHIYDMRKRKQLGILLSHAGSITALKFYPPLSKSHLLSGSDDGHIIIWRVGSWELLKSLK 124 (362)
T ss_pred eEEEe--cceeEeccCCCCcEEEEeccchhhhcceeccccceEEEEecCCcchhheeeecCCCcEEEEEcCCeEEeeeec
Confidence 44444 6899999987 899999988654 89999999999999999999999999
Q ss_pred cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeE--eecCCc---------------------------------
Q 040274 107 YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQ--TLTGHA--------------------------------- 151 (359)
Q Consensus 107 ~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~--~~~~~v--------------------------------- 151 (359)
+|.+.|+.++++|.|++.++.+.|+.+++||+-.|+.-. .+....
T Consensus 125 ~H~~~Vt~lsiHPS~KLALsVg~D~~lr~WNLV~Gr~a~v~~L~~~at~v~w~~~Gd~F~v~~~~~i~i~q~d~A~v~~~ 204 (362)
T KOG0294|consen 125 AHKGQVTDLSIHPSGKLALSVGGDQVLRTWNLVRGRVAFVLNLKNKATLVSWSPQGDHFVVSGRNKIDIYQLDNASVFRE 204 (362)
T ss_pred ccccccceeEecCCCceEEEEcCCceeeeehhhcCccceeeccCCcceeeEEcCCCCEEEEEeccEEEEEecccHhHhhh
Confidence 999999999999999999999999999999987664322 112222
Q ss_pred -------eeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEE--ccCCCEEEEEeCCCeEEEEE
Q 040274 152 -------KTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSF--RPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 152 -------~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~--sp~~~~l~~g~~dg~~~i~~ 221 (359)
.|+.|...+ +++|+.++.|.+||... ..+...+..|.. +|-++.+ .|++.+|+++++||.|.||.
T Consensus 205 i~~~~r~l~~~~l~~~~L~vG~d~~~i~~~D~ds-~~~~~~~~AH~~----RVK~i~~~~~~~~~~lvTaSSDG~I~vWd 279 (362)
T KOG0294|consen 205 IENPKRILCATFLDGSELLVGGDNEWISLKDTDS-DTPLTEFLAHEN----RVKDIASYTNPEHEYLVTASSDGFIKVWD 279 (362)
T ss_pred hhccccceeeeecCCceEEEecCCceEEEeccCC-Cccceeeecchh----heeeeEEEecCCceEEEEeccCceEEEEE
Confidence 233333333 55555566667776332 344555555543 6666653 35667788888888777775
Q ss_pred c
Q 040274 222 P 222 (359)
Q Consensus 222 ~ 222 (359)
-
T Consensus 280 ~ 280 (362)
T KOG0294|consen 280 I 280 (362)
T ss_pred c
Confidence 4
No 111
>KOG0270 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.75 E-value=3.2e-17 Score=145.18 Aligned_cols=154 Identities=12% Similarity=0.143 Sum_probs=129.8
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCCC---ee
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHP-NGHLMATTGKECKIKIWDLRKY---EV 143 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~~---~~ 143 (359)
.|.+|+|+. ..+.|++||.|.+|.+||+.+++|..++..|.+.|.++.|+| .+.+|++|+.|++|.+.|.|.. ..
T Consensus 245 avl~Ls~n~~~~nVLaSgsaD~TV~lWD~~~g~p~~s~~~~~k~Vq~l~wh~~~p~~LLsGs~D~~V~l~D~R~~~~s~~ 324 (463)
T KOG0270|consen 245 AVLALSWNRNFRNVLASGSADKTVKLWDVDTGKPKSSITHHGKKVQTLEWHPYEPSVLLSGSYDGTVALKDCRDPSNSGK 324 (463)
T ss_pred HHHHHHhccccceeEEecCCCceEEEEEcCCCCcceehhhcCCceeEEEecCCCceEEEeccccceEEeeeccCccccCc
Confidence 456788887 456899999999999999999999999999999999999999 5678999999999999999942 23
Q ss_pred eEeecCCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCC-CEEEEEeCCCeEEE
Q 040274 144 LQTLTGHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYE-DVLGIGHSMGWSGI 219 (359)
Q Consensus 144 ~~~~~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~-~~l~~g~~dg~~~i 219 (359)
...+.+.|-.+.|.|.. ++++..||+|+-+|++..+.++..+..|.. .|.++++++.- .+|++++.++.+.+
T Consensus 325 ~wk~~g~VEkv~w~~~se~~f~~~tddG~v~~~D~R~~~~~vwt~~AHd~----~ISgl~~n~~~p~~l~t~s~d~~Vkl 400 (463)
T KOG0270|consen 325 EWKFDGEVEKVAWDPHSENSFFVSTDDGTVYYFDIRNPGKPVWTLKAHDD----EISGLSVNIQTPGLLSTASTDKVVKL 400 (463)
T ss_pred eEEeccceEEEEecCCCceeEEEecCCceEEeeecCCCCCceeEEEeccC----CcceEEecCCCCcceeeccccceEEE
Confidence 44557889999999987 777778999999999988888888888865 89999999865 56788888888888
Q ss_pred EEcCCCC
Q 040274 220 LVPRSSE 226 (359)
Q Consensus 220 ~~~gs~~ 226 (359)
|.....+
T Consensus 401 w~~~~~~ 407 (463)
T KOG0270|consen 401 WKFDVDS 407 (463)
T ss_pred EeecCCC
Confidence 7654433
No 112
>KOG2096 consensus WD40 repeat protein [General function prediction only]
Probab=99.75 E-value=3.9e-17 Score=139.22 Aligned_cols=158 Identities=19% Similarity=0.258 Sum_probs=110.1
Q ss_pred eEEEEcCCCCEEEEEeCCCeEEEEeCC---CC-----cceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC--
Q 040274 71 DLMRVNPFNGVVSLGHSGGTVTMWKPT---TS-----ALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRK-- 140 (359)
Q Consensus 71 ~~l~~sp~~~~l~tg~~dg~v~lwd~~---~~-----~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~-- 140 (359)
+..+.||+|.+|++++..-.|.+|.+- .| ..+..+.+|...|.+++|+|+...++|.+.||++++||++-
T Consensus 232 ~~aavSP~GRFia~~gFTpDVkVwE~~f~kdG~fqev~rvf~LkGH~saV~~~aFsn~S~r~vtvSkDG~wriwdtdVrY 311 (420)
T KOG2096|consen 232 YDAAVSPDGRFIAVSGFTPDVKVWEPIFTKDGTFQEVKRVFSLKGHQSAVLAAAFSNSSTRAVTVSKDGKWRIWDTDVRY 311 (420)
T ss_pred cceeeCCCCcEEEEecCCCCceEEEEEeccCcchhhhhhhheeccchhheeeeeeCCCcceeEEEecCCcEEEeeccceE
Confidence 444556666666666665566666542 12 13456779999999999999999999999999999999853
Q ss_pred --C---eeeEee-------cCCceeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCE
Q 040274 141 --Y---EVLQTL-------TGHAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDV 207 (359)
Q Consensus 141 --~---~~~~~~-------~~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~ 207 (359)
+ ..+.+. .+....+..||+| .++.+.+..+.+|...++ .....+... |+..|.+++|+|+|++
T Consensus 312 ~~~qDpk~Lk~g~~pl~aag~~p~RL~lsP~g~~lA~s~gs~l~~~~se~g-~~~~~~e~~---h~~~Is~is~~~~g~~ 387 (420)
T KOG2096|consen 312 EAGQDPKILKEGSAPLHAAGSEPVRLELSPSGDSLAVSFGSDLKVFASEDG-KDYPELEDI---HSTTISSISYSSDGKY 387 (420)
T ss_pred ecCCCchHhhcCCcchhhcCCCceEEEeCCCCcEEEeecCCceEEEEcccC-ccchhHHHh---hcCceeeEEecCCCcE
Confidence 1 122222 1234589999999 999999999999986654 444444332 4558999999999999
Q ss_pred EEEEeCCCeEEEEE-cCCCCCceeeec
Q 040274 208 LGIGHSMGWSGILV-PRSSEPNFDSWV 233 (359)
Q Consensus 208 l~~g~~dg~~~i~~-~gs~~~~~~~~~ 233 (359)
++++++. .++++- +...+..+..|+
T Consensus 388 ~atcGdr-~vrv~~ntpg~~~~V~~~~ 413 (420)
T KOG2096|consen 388 IATCGDR-YVRVIRNTPGWHSRVVKLN 413 (420)
T ss_pred Eeeecce-eeeeecCCCchhhHHHHhh
Confidence 9987754 455554 333444455554
No 113
>KOG0269 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.75 E-value=1.4e-17 Score=156.39 Aligned_cols=162 Identities=16% Similarity=0.265 Sum_probs=133.6
Q ss_pred eEEEECCCC-CEEEEecc-----------------------ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCC-cceEEe
Q 040274 52 ILWILPSSG-RYMAVAGR-----------------------RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTS-ALLIKM 105 (359)
Q Consensus 52 ~~l~~spdg-~~l~~~~~-----------------------~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~-~~~~~~ 105 (359)
.+++|++-. .+|++|+. .|..+.|+| .+..|++++.+|.+++||++.. .+...+
T Consensus 137 ~~ldfh~tep~iliSGSQDg~vK~~DlR~~~S~~t~~~nSESiRDV~fsp~~~~~F~s~~dsG~lqlWDlRqp~r~~~k~ 216 (839)
T KOG0269|consen 137 NKLDFHSTEPNILISGSQDGTVKCWDLRSKKSKSTFRSNSESIRDVKFSPGYGNKFASIHDSGYLQLWDLRQPDRCEKKL 216 (839)
T ss_pred eeeeeccCCccEEEecCCCceEEEEeeecccccccccccchhhhceeeccCCCceEEEecCCceEEEeeccCchhHHHHh
Confidence 788888754 45556655 899999999 7889999999999999999854 667788
Q ss_pred ecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCe--eeEee--cCCceeEEEcCCC---cEEEEc--CCcEEEEcCC
Q 040274 106 LYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYE--VLQTL--TGHAKTLDFSQKG---LLAVGT--GSFAQILGDF 176 (359)
Q Consensus 106 ~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~--~~~~~--~~~v~~~~~s~~g---l~~~~~--d~~i~v~d~~ 176 (359)
.+|.++|.|+.|+|++.+|||||.|++|+|||+.++. ++.++ -.++.++.|-|.. |.+++. |-.|+|||++
T Consensus 217 ~AH~GpV~c~nwhPnr~~lATGGRDK~vkiWd~t~~~~~~~~tInTiapv~rVkWRP~~~~hLAtcsmv~dtsV~VWDvr 296 (839)
T KOG0269|consen 217 TAHNGPVLCLNWHPNREWLATGGRDKMVKIWDMTDSRAKPKHTINTIAPVGRVKWRPARSYHLATCSMVVDTSVHVWDVR 296 (839)
T ss_pred hcccCceEEEeecCCCceeeecCCCccEEEEeccCCCccceeEEeecceeeeeeeccCccchhhhhhccccceEEEEeec
Confidence 8999999999999999999999999999999998754 35555 4578999999987 555543 6799999998
Q ss_pred CCCccccccccccCCCCcceeEEEEcc-CCCEEEEEeCCCeE
Q 040274 177 SGSHNYSRYMGNSMVKGYQIGKVSFRP-YEDVLGIGHSMGWS 217 (359)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~v~~~~~sp-~~~~l~~g~~dg~~ 217 (359)
...-+...+..|.. .++.++|.. |-..|.+++.||++
T Consensus 297 RPYIP~~t~~eH~~----~vt~i~W~~~d~~~l~s~sKD~tv 334 (839)
T KOG0269|consen 297 RPYIPYATFLEHTD----SVTGIAWDSGDRINLWSCSKDGTV 334 (839)
T ss_pred cccccceeeeccCc----cccceeccCCCceeeEeecCccHH
Confidence 88777777877764 788899976 44678889999875
No 114
>KOG0305 consensus Anaphase promoting complex, Cdc20, Cdh1, and Ama1 subunits [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=99.74 E-value=2.6e-17 Score=152.06 Aligned_cols=150 Identities=17% Similarity=0.269 Sum_probs=126.2
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeec-CCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEe-
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLY-HQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQT- 146 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~-h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~- 146 (359)
.|+++.|+++|.+|++|..+|.|.|||..+...+..+.+ |...|.+++|+ +..+.+|+.|+.|..+|++..+.+..
T Consensus 219 ~vtSv~ws~~G~~LavG~~~g~v~iwD~~~~k~~~~~~~~h~~rvg~laW~--~~~lssGsr~~~I~~~dvR~~~~~~~~ 296 (484)
T KOG0305|consen 219 LVTSVKWSPDGSHLAVGTSDGTVQIWDVKEQKKTRTLRGSHASRVGSLAWN--SSVLSSGSRDGKILNHDVRISQHVVST 296 (484)
T ss_pred ceEEEEECCCCCEEEEeecCCeEEEEehhhccccccccCCcCceeEEEecc--CceEEEecCCCcEEEEEEecchhhhhh
Confidence 799999999999999999999999999999888888888 99999999998 66899999999999999998765444
Q ss_pred e---cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccC-CCEEEEEeC--CCeEE
Q 040274 147 L---TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPY-EDVLGIGHS--MGWSG 218 (359)
Q Consensus 147 ~---~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-~~~l~~g~~--dg~~~ 218 (359)
+ ...|..+.|++|+ +++++.|+.+.|||. ....+...+..|.. .|-.++|||. ..+||+|+. |+.+.
T Consensus 297 ~~~H~qeVCgLkws~d~~~lASGgnDN~~~Iwd~-~~~~p~~~~~~H~a----AVKA~awcP~q~~lLAsGGGs~D~~i~ 371 (484)
T KOG0305|consen 297 LQGHRQEVCGLKWSPDGNQLASGGNDNVVFIWDG-LSPEPKFTFTEHTA----AVKALAWCPWQSGLLATGGGSADRCIK 371 (484)
T ss_pred hhcccceeeeeEECCCCCeeccCCCccceEeccC-CCccccEEEeccce----eeeEeeeCCCccCceEEcCCCcccEEE
Confidence 4 3458999999999 778889999999996 44456667777765 8999999995 477887764 66777
Q ss_pred EEEcCCC
Q 040274 219 ILVPRSS 225 (359)
Q Consensus 219 i~~~gs~ 225 (359)
+|.+..+
T Consensus 372 fwn~~~g 378 (484)
T KOG0305|consen 372 FWNTNTG 378 (484)
T ss_pred EEEcCCC
Confidence 7765544
No 115
>KOG0274 consensus Cdc4 and related F-box and WD-40 proteins [General function prediction only]
Probab=99.73 E-value=2.4e-16 Score=150.42 Aligned_cols=163 Identities=15% Similarity=0.202 Sum_probs=140.4
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
.|.++++..-+.++++|+.|.++++||..+|.+...+.+|.+.|.++...+ .++++|+.|.+|++||+.++.+++.+.
T Consensus 251 ~V~~l~~~~~~~~lvsgS~D~t~rvWd~~sg~C~~~l~gh~stv~~~~~~~--~~~~sgs~D~tVkVW~v~n~~~l~l~~ 328 (537)
T KOG0274|consen 251 GVWGLAFPSGGDKLVSGSTDKTERVWDCSTGECTHSLQGHTSSVRCLTIDP--FLLVSGSRDNTVKVWDVTNGACLNLLR 328 (537)
T ss_pred CceeEEEecCCCEEEEEecCCcEEeEecCCCcEEEEecCCCceEEEEEccC--ceEeeccCCceEEEEeccCcceEEEec
Confidence 899999987788999999999999999999999999999999999998754 578889999999999999999998885
Q ss_pred ---CCceeEEEcCCCcEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE------
Q 040274 149 ---GHAKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI------ 219 (359)
Q Consensus 149 ---~~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i------ 219 (359)
++|.++.++.+-+++++.|++|.|||+. ....+..+.+|.+ .|.++.+.+. ..+++|+.|+.+.+
T Consensus 329 ~h~~~V~~v~~~~~~lvsgs~d~~v~VW~~~-~~~cl~sl~gH~~----~V~sl~~~~~-~~~~Sgs~D~~IkvWdl~~~ 402 (537)
T KOG0274|consen 329 GHTGPVNCVQLDEPLLVSGSYDGTVKVWDPR-TGKCLKSLSGHTG----RVYSLIVDSE-NRLLSGSLDTTIKVWDLRTK 402 (537)
T ss_pred cccccEEEEEecCCEEEEEecCceEEEEEhh-hceeeeeecCCcc----eEEEEEecCc-ceEEeeeeccceEeecCCch
Confidence 4588999883339999999999999976 4477777777765 8999988665 89999999998776
Q ss_pred -----------------------EEcCCCCCceeeeccCCCCC
Q 040274 220 -----------------------LVPRSSEPNFDSWVANPFET 239 (359)
Q Consensus 220 -----------------------~~~gs~~~~~~~~~~~~~~~ 239 (359)
+++++.|+.+++|+.+..+.
T Consensus 403 ~~c~~tl~~h~~~v~~l~~~~~~Lvs~~aD~~Ik~WD~~~~~~ 445 (537)
T KOG0274|consen 403 RKCIHTLQGHTSLVSSLLLRDNFLVSSSADGTIKLWDAEEGEC 445 (537)
T ss_pred hhhhhhhcCCcccccccccccceeEeccccccEEEeecccCce
Confidence 56777788999998776654
No 116
>KOG0300 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.73 E-value=8.6e-17 Score=137.06 Aligned_cols=149 Identities=11% Similarity=0.194 Sum_probs=130.0
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCC-eeeEee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKY-EVLQTL 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~-~~~~~~ 147 (359)
.|.++.|-..|..+++++.|.+..+||+.++.++..+.+|....+.++-+|..+++++++.|.+.++||++.. ..+..|
T Consensus 274 vV~a~dWL~gg~Q~vTaSWDRTAnlwDVEtge~v~~LtGHd~ELtHcstHptQrLVvTsSrDtTFRLWDFReaI~sV~VF 353 (481)
T KOG0300|consen 274 VVSACDWLAGGQQMVTASWDRTANLWDVETGEVVNILTGHDSELTHCSTHPTQRLVVTSSRDTTFRLWDFREAIQSVAVF 353 (481)
T ss_pred ceEehhhhcCcceeeeeeccccceeeeeccCceeccccCcchhccccccCCcceEEEEeccCceeEeccchhhcceeeee
Confidence 6888889889999999999999999999999999999999999999999999999999999999999999943 345556
Q ss_pred cC---CceeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEc
Q 040274 148 TG---HAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVP 222 (359)
Q Consensus 148 ~~---~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~ 222 (359)
.| .|+++.|.-+. +++++.|.+|.|||+.+...++.++.... +++.++.+-.+.+|+.-+++..+++|.-
T Consensus 354 QGHtdtVTS~vF~~dd~vVSgSDDrTvKvWdLrNMRsplATIRtdS-----~~NRvavs~g~~iIAiPhDNRqvRlfDl 427 (481)
T KOG0300|consen 354 QGHTDTVTSVVFNTDDRVVSGSDDRTVKVWDLRNMRSPLATIRTDS-----PANRVAVSKGHPIIAIPHDNRQVRLFDL 427 (481)
T ss_pred cccccceeEEEEecCCceeecCCCceEEEeeeccccCcceeeecCC-----ccceeEeecCCceEEeccCCceEEEEec
Confidence 55 48999999888 99999999999999988766666665543 7999999998889999888887777654
No 117
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.73 E-value=2.2e-16 Score=130.07 Aligned_cols=171 Identities=12% Similarity=0.159 Sum_probs=131.3
Q ss_pred eEEEECC--CCCEEEEecc-------------------------ceeEEEEcC--CCCEEEEEeCCCeEEEEeCCCC---
Q 040274 52 ILWILPS--SGRYMAVAGR-------------------------RTDLMRVNP--FNGVVSLGHSGGTVTMWKPTTS--- 99 (359)
Q Consensus 52 ~~l~~sp--dg~~l~~~~~-------------------------~v~~l~~sp--~~~~l~tg~~dg~v~lwd~~~~--- 99 (359)
+-++|.. -|.+||+++. .|++++|.| .|-.|++++.||.|.|.+.++.
T Consensus 60 wqv~wahPk~G~iLAScsYDgkVIiWke~~g~w~k~~e~~~h~~SVNsV~wapheygl~LacasSDG~vsvl~~~~~g~w 139 (299)
T KOG1332|consen 60 WKVAWAHPKFGTILASCSYDGKVIIWKEENGRWTKAYEHAAHSASVNSVAWAPHEYGLLLACASSDGKVSVLTYDSSGGW 139 (299)
T ss_pred eEEeecccccCcEeeEeecCceEEEEecCCCchhhhhhhhhhcccceeecccccccceEEEEeeCCCcEEEEEEcCCCCc
Confidence 7777743 7999998886 899999998 4668999999999999988754
Q ss_pred cceEEeecCCCCeEEEEEecC---C-----------CEEEEecCCCeEEEEEcCCCee--eEee---cCCceeEEEcCCC
Q 040274 100 ALLIKMLYHQGPVSALAFHPN---G-----------HLMATTGKECKIKIWDLRKYEV--LQTL---TGHAKTLDFSQKG 160 (359)
Q Consensus 100 ~~~~~~~~h~~~v~~l~~~p~---g-----------~~l~s~~~d~~i~vwd~~~~~~--~~~~---~~~v~~~~~s~~g 160 (359)
.......+|.-.|++++|.|. | ..|++||.|..|+||+...+.- -.++ .+.|..++|.|.-
T Consensus 140 ~t~ki~~aH~~GvnsVswapa~~~g~~~~~~~~~~~krlvSgGcDn~VkiW~~~~~~w~~e~~l~~H~dwVRDVAwaP~~ 219 (299)
T KOG1332|consen 140 TTSKIVFAHEIGVNSVSWAPASAPGSLVDQGPAAKVKRLVSGGCDNLVKIWKFDSDSWKLERTLEGHKDWVRDVAWAPSV 219 (299)
T ss_pred cchhhhhccccccceeeecCcCCCccccccCcccccceeeccCCccceeeeecCCcchhhhhhhhhcchhhhhhhhcccc
Confidence 222345589999999999995 4 4699999999999999987632 2223 4558999999974
Q ss_pred ------cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCC
Q 040274 161 ------LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRS 224 (359)
Q Consensus 161 ------l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs 224 (359)
+++++.||+|.||-..........-.-+. ....+++++||+.|++|++++.|+.+.+|....
T Consensus 220 gl~~s~iAS~SqDg~viIwt~~~e~e~wk~tll~~--f~~~~w~vSWS~sGn~LaVs~GdNkvtlwke~~ 287 (299)
T KOG1332|consen 220 GLPKSTIASCSQDGTVIIWTKDEEYEPWKKTLLEE--FPDVVWRVSWSLSGNILAVSGGDNKVTLWKENV 287 (299)
T ss_pred CCCceeeEEecCCCcEEEEEecCccCccccccccc--CCcceEEEEEeccccEEEEecCCcEEEEEEeCC
Confidence 78899999999997543322222222221 223699999999999999999999888887643
No 118
>KOG0308 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.72 E-value=1e-16 Score=148.08 Aligned_cols=146 Identities=16% Similarity=0.242 Sum_probs=126.3
Q ss_pred ceeEEEE-cCCCCEEEEEeCCCeEEEEeCCCCcc----------eEEee-cCCCCeEEEEEecCCCEEEEecCCCeEEEE
Q 040274 69 RTDLMRV-NPFNGVVSLGHSGGTVTMWKPTTSAL----------LIKML-YHQGPVSALAFHPNGHLMATTGKECKIKIW 136 (359)
Q Consensus 69 ~v~~l~~-sp~~~~l~tg~~dg~v~lwd~~~~~~----------~~~~~-~h~~~v~~l~~~p~g~~l~s~~~d~~i~vw 136 (359)
.|.|+++ -+++..+|+|+-|+.|.+||++++.. ...+. ++...|++++.++.|..+++|+..+.|++|
T Consensus 119 YVkcla~~ak~~~lvaSgGLD~~IflWDin~~~~~l~~s~n~~t~~sl~sG~k~siYSLA~N~t~t~ivsGgtek~lr~w 198 (735)
T KOG0308|consen 119 YVKCLAYIAKNNELVASGGLDRKIFLWDINTGTATLVASFNNVTVNSLGSGPKDSIYSLAMNQTGTIIVSGGTEKDLRLW 198 (735)
T ss_pred hheeeeecccCceeEEecCCCccEEEEEccCcchhhhhhccccccccCCCCCccceeeeecCCcceEEEecCcccceEEe
Confidence 7999999 77888999999999999999997722 22233 788899999999999999999999999999
Q ss_pred EcCCCeeeEeecCC---ceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEE
Q 040274 137 DLRKYEVLQTLTGH---AKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIG 211 (359)
Q Consensus 137 d~~~~~~~~~~~~~---v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g 211 (359)
|.++.+.+..+.|| |.++-.++|| ++++++||+|++||+... ..+.++..|.. .|+++..+|+=.++++|
T Consensus 199 Dprt~~kimkLrGHTdNVr~ll~~dDGt~~ls~sSDgtIrlWdLgqQ-rCl~T~~vH~e----~VWaL~~~~sf~~vYsG 273 (735)
T KOG0308|consen 199 DPRTCKKIMKLRGHTDNVRVLLVNDDGTRLLSASSDGTIRLWDLGQQ-RCLATYIVHKE----GVWALQSSPSFTHVYSG 273 (735)
T ss_pred ccccccceeeeeccccceEEEEEcCCCCeEeecCCCceEEeeecccc-ceeeeEEeccC----ceEEEeeCCCcceEEec
Confidence 99999888888665 8899999999 999999999999996443 66777777754 69999999999999999
Q ss_pred eCCCeEEE
Q 040274 212 HSMGWSGI 219 (359)
Q Consensus 212 ~~dg~~~i 219 (359)
+.||.+..
T Consensus 274 ~rd~~i~~ 281 (735)
T KOG0308|consen 274 GRDGNIYR 281 (735)
T ss_pred CCCCcEEe
Confidence 99998654
No 119
>KOG0303 consensus Actin-binding protein Coronin, contains WD40 repeats [Cytoskeleton]
Probab=99.72 E-value=1.1e-16 Score=139.97 Aligned_cols=163 Identities=17% Similarity=0.287 Sum_probs=130.5
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCC-------cceEEeecCCCCeEEEEEecC-CCEEEEecCCCeEEEEEcC
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTS-------ALLIKMLYHQGPVSALAFHPN-GHLMATTGKECKIKIWDLR 139 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~-------~~~~~~~~h~~~v~~l~~~p~-g~~l~s~~~d~~i~vwd~~ 139 (359)
+|..++|+| +...|++||.|.+|.||++..+ +++..+.+|...|.-+.|+|. .+.|+++|.|.+|.+||+.
T Consensus 83 ~vLDi~w~PfnD~vIASgSeD~~v~vW~IPe~~l~~~ltepvv~L~gH~rrVg~V~wHPtA~NVLlsag~Dn~v~iWnv~ 162 (472)
T KOG0303|consen 83 PVLDIDWCPFNDCVIASGSEDTKVMVWQIPENGLTRDLTEPVVELYGHQRRVGLVQWHPTAPNVLLSAGSDNTVSIWNVG 162 (472)
T ss_pred cccccccCccCCceeecCCCCceEEEEECCCcccccCcccceEEEeecceeEEEEeecccchhhHhhccCCceEEEEecc
Confidence 899999999 5678999999999999997533 567889999999999999995 4578999999999999999
Q ss_pred CCeeeEee--cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 140 KYEVLQTL--TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 140 ~~~~~~~~--~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
+|+.+.++ ++-|++++|+.+| +++++.|..|+|||.+.+ ..+..-..|. +..-..+.|..+|.++.+|.+..
T Consensus 163 tgeali~l~hpd~i~S~sfn~dGs~l~TtckDKkvRv~dpr~~-~~v~e~~~he---G~k~~Raifl~~g~i~tTGfsr~ 238 (472)
T KOG0303|consen 163 TGEALITLDHPDMVYSMSFNRDGSLLCTTCKDKKVRVIDPRRG-TVVSEGVAHE---GAKPARAIFLASGKIFTTGFSRM 238 (472)
T ss_pred CCceeeecCCCCeEEEEEeccCCceeeeecccceeEEEcCCCC-cEeeeccccc---CCCcceeEEeccCceeeeccccc
Confidence 99988777 5568999999999 788889999999997665 5555556664 34456667777777554443322
Q ss_pred e------------------------------------EEEEEcCCCCCceeeeccC
Q 040274 216 W------------------------------------SGILVPRSSEPNFDSWVAN 235 (359)
Q Consensus 216 ~------------------------------------~~i~~~gs~~~~~~~~~~~ 235 (359)
. ..||+-|-||++|+-|+++
T Consensus 239 seRq~aLwdp~nl~eP~~~~elDtSnGvl~PFyD~dt~ivYl~GKGD~~IRYyEit 294 (472)
T KOG0303|consen 239 SERQIALWDPNNLEEPIALQELDTSNGVLLPFYDPDTSIVYLCGKGDSSIRYFEIT 294 (472)
T ss_pred cccceeccCcccccCcceeEEeccCCceEEeeecCCCCEEEEEecCCcceEEEEec
Confidence 1 2247888999999999765
No 120
>KOG2321 consensus WD40 repeat protein [General function prediction only]
Probab=99.72 E-value=1.6e-16 Score=144.98 Aligned_cols=152 Identities=18% Similarity=0.294 Sum_probs=118.1
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee------cCCC-----CeEEEEEecCCCEEEEecCCCeEEEEE
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML------YHQG-----PVSALAFHPNGHLMATTGKECKIKIWD 137 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~------~h~~-----~v~~l~~~p~g~~l~s~~~d~~i~vwd 137 (359)
.++++..++.+.+|++|+.+|.|..||+++...+.++. .|.+ .|+++.|+.+|-.+++|+.+|.|.|||
T Consensus 177 ~lN~v~in~~hgLla~Gt~~g~VEfwDpR~ksrv~~l~~~~~v~s~pg~~~~~svTal~F~d~gL~~aVGts~G~v~iyD 256 (703)
T KOG2321|consen 177 ELNVVSINEEHGLLACGTEDGVVEFWDPRDKSRVGTLDAASSVNSHPGGDAAPSVTALKFRDDGLHVAVGTSTGSVLIYD 256 (703)
T ss_pred cceeeeecCccceEEecccCceEEEecchhhhhheeeecccccCCCccccccCcceEEEecCCceeEEeeccCCcEEEEE
Confidence 78999999999999999999999999999876665554 2333 399999999999999999999999999
Q ss_pred cCCCeeeEee----cCCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEE
Q 040274 138 LRKYEVLQTL----TGHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGI 210 (359)
Q Consensus 138 ~~~~~~~~~~----~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~ 210 (359)
+++.+++..- ..+|..+.|.+.+ .++......++|||-.++ .....+.. ...+..+|+-|++..+++
T Consensus 257 LRa~~pl~~kdh~~e~pi~~l~~~~~~~q~~v~S~Dk~~~kiWd~~~G-k~~asiEp-----t~~lND~C~~p~sGm~f~ 330 (703)
T KOG2321|consen 257 LRASKPLLVKDHGYELPIKKLDWQDTDQQNKVVSMDKRILKIWDECTG-KPMASIEP-----TSDLNDFCFVPGSGMFFT 330 (703)
T ss_pred cccCCceeecccCCccceeeecccccCCCceEEecchHHhhhcccccC-Cceeeccc-----cCCcCceeeecCCceEEE
Confidence 9998876554 4568999998874 444445578999995444 33333222 226899999999999999
Q ss_pred EeCCCeE-EEEEcCCCC
Q 040274 211 GHSMGWS-GILVPRSSE 226 (359)
Q Consensus 211 g~~dg~~-~i~~~gs~~ 226 (359)
+-.++-+ .+|+|.-|.
T Consensus 331 Ane~~~m~~yyiP~LGP 347 (703)
T KOG2321|consen 331 ANESSKMHTYYIPSLGP 347 (703)
T ss_pred ecCCCcceeEEccccCC
Confidence 9888755 456665543
No 121
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=99.72 E-value=3.2e-16 Score=139.54 Aligned_cols=167 Identities=18% Similarity=0.298 Sum_probs=128.3
Q ss_pred eEEEECCCCCEEEEecc----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCC
Q 040274 52 ILWILPSSGRYMAVAGR----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQ 109 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~ 109 (359)
-.+.+||++++|++.|. .|..++|+.++..|++++.+|.|.+||+++..++..+.. .
T Consensus 307 e~FeVShd~~fia~~G~~G~I~lLhakT~eli~s~KieG~v~~~~fsSdsk~l~~~~~~GeV~v~nl~~~~~~~rf~D-~ 385 (514)
T KOG2055|consen 307 ERFEVSHDSNFIAIAGNNGHIHLLHAKTKELITSFKIEGVVSDFTFSSDSKELLASGGTGEVYVWNLRQNSCLHRFVD-D 385 (514)
T ss_pred heeEecCCCCeEEEcccCceEEeehhhhhhhhheeeeccEEeeEEEecCCcEEEEEcCCceEEEEecCCcceEEEEee-c
Confidence 45677899999999887 789999999999999999999999999999998888864 3
Q ss_pred CCe--EEEEEecCCCEEEEecCCCeEEEEEcCC------CeeeEee---cCCceeEEEcCCC-cEEE-E--cCCcEEEEc
Q 040274 110 GPV--SALAFHPNGHLMATTGKECKIKIWDLRK------YEVLQTL---TGHAKTLDFSQKG-LLAV-G--TGSFAQILG 174 (359)
Q Consensus 110 ~~v--~~l~~~p~g~~l~s~~~d~~i~vwd~~~------~~~~~~~---~~~v~~~~~s~~g-l~~~-~--~d~~i~v~d 174 (359)
+.| ++++.+++|.|||+|+..|.|.|||..+ .+++.++ ...|+++.|+|++ +++. | ..+.+++..
T Consensus 386 G~v~gts~~~S~ng~ylA~GS~~GiVNIYd~~s~~~s~~PkPik~~dNLtt~Itsl~Fn~d~qiLAiaS~~~knalrLVH 465 (514)
T KOG2055|consen 386 GSVHGTSLCISLNGSYLATGSDSGIVNIYDGNSCFASTNPKPIKTVDNLTTAITSLQFNHDAQILAIASRVKKNALRLVH 465 (514)
T ss_pred CccceeeeeecCCCceEEeccCcceEEEeccchhhccCCCCchhhhhhhheeeeeeeeCcchhhhhhhhhccccceEEEe
Confidence 333 4566678999999999999999999754 3455554 4578999999999 4433 3 357788777
Q ss_pred CCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 175 DFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
+..- ....-++.... .-..|+|++|+|.+.+|++|..+|.+.+|-
T Consensus 466 vPS~-TVFsNfP~~n~-~vg~vtc~aFSP~sG~lAvGNe~grv~l~k 510 (514)
T KOG2055|consen 466 VPSC-TVFSNFPTSNT-KVGHVTCMAFSPNSGYLAVGNEAGRVHLFK 510 (514)
T ss_pred ccce-eeeccCCCCCC-cccceEEEEecCCCceEEeecCCCceeeEe
Confidence 5322 22222222222 233699999999999999999999777663
No 122
>KOG2919 consensus Guanine nucleotide-binding protein [General function prediction only]
Probab=99.71 E-value=2e-16 Score=135.11 Aligned_cols=164 Identities=18% Similarity=0.221 Sum_probs=134.2
Q ss_pred hhccceEEEECCCCCEEEEecc------------------------------ceeEEEEcC-CCCEEEEEeCCCeEEEEe
Q 040274 47 KNLVHILWILPSSGRYMAVAGR------------------------------RTDLMRVNP-FNGVVSLGHSGGTVTMWK 95 (359)
Q Consensus 47 ~ll~~~~l~~spdg~~l~~~~~------------------------------~v~~l~~sp-~~~~l~tg~~dg~v~lwd 95 (359)
.+...++|+|+|||.+|+.|-. -+.|++||| +...++.|+....+-||.
T Consensus 157 e~taAhsL~Fs~DGeqlfaGykrcirvFdt~RpGr~c~vy~t~~~~k~gq~giisc~a~sP~~~~~~a~gsY~q~~giy~ 236 (406)
T KOG2919|consen 157 EYTAAHSLQFSPDGEQLFAGYKRCIRVFDTSRPGRDCPVYTTVTKGKFGQKGIISCFAFSPMDSKTLAVGSYGQRVGIYN 236 (406)
T ss_pred hhhhheeEEecCCCCeEeecccceEEEeeccCCCCCCcchhhhhcccccccceeeeeeccCCCCcceeeecccceeeeEe
Confidence 3445599999999999998876 578999999 666999999999999999
Q ss_pred CCCCcceEEeecCCCCeEEEEEecCCCEEEEecC-CCeEEEEEcCCC-eeeEeecCCce------eEEEcCCC--cEEEE
Q 040274 96 PTTSALLIKMLYHQGPVSALAFHPNGHLMATTGK-ECKIKIWDLRKY-EVLQTLTGHAK------TLDFSQKG--LLAVG 165 (359)
Q Consensus 96 ~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~-d~~i~vwd~~~~-~~~~~~~~~v~------~~~~s~~g--l~~~~ 165 (359)
-..+.++..+.+|.+.|+.+.|+++|+.|++|.. |..|-.||+|.. .++..+..++. -++..|+| |++++
T Consensus 237 ~~~~~pl~llggh~gGvThL~~~edGn~lfsGaRk~dkIl~WDiR~~~~pv~~L~rhv~~TNQRI~FDld~~~~~LasG~ 316 (406)
T KOG2919|consen 237 DDGRRPLQLLGGHGGGVTHLQWCEDGNKLFSGARKDDKILCWDIRYSRDPVYALERHVGDTNQRILFDLDPKGEILASGD 316 (406)
T ss_pred cCCCCceeeecccCCCeeeEEeccCcCeecccccCCCeEEEEeehhccchhhhhhhhccCccceEEEecCCCCceeeccC
Confidence 8889999999999999999999999999999885 778999999964 46666655442 34556778 55566
Q ss_pred cCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 166 TGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 166 ~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
.+|.|++||+...+..+..+..+.. .|+.++++|.-.++++++..
T Consensus 317 tdG~V~vwdlk~~gn~~sv~~~~sd----~vNgvslnP~mpilatssGq 361 (406)
T KOG2919|consen 317 TDGSVRVWDLKDLGNEVSVTGNYSD----TVNGVSLNPIMPILATSSGQ 361 (406)
T ss_pred CCccEEEEecCCCCCcccccccccc----cccceecCcccceeeeccCc
Confidence 8999999998765565666666654 79999999998877777655
No 123
>KOG0641 consensus WD40 repeat protein [General function prediction only]
Probab=99.71 E-value=1.8e-15 Score=123.47 Aligned_cols=170 Identities=16% Similarity=0.225 Sum_probs=130.9
Q ss_pred eEEEECCCCCEEEEecc--------------------------------------ceeEEEEcCCCCEEEEEeCCCeEEE
Q 040274 52 ILWILPSSGRYMAVAGR--------------------------------------RTDLMRVNPFNGVVSLGHSGGTVTM 93 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~--------------------------------------~v~~l~~sp~~~~l~tg~~dg~v~l 93 (359)
.+++|+|.|.+.+.|+. .|.|.+|+|+|.+|++|++|.+|.+
T Consensus 36 rav~fhp~g~lyavgsnskt~ric~yp~l~~~r~~hea~~~pp~v~~kr~khhkgsiyc~~ws~~geliatgsndk~ik~ 115 (350)
T KOG0641|consen 36 RAVAFHPAGGLYAVGSNSKTFRICAYPALIDLRHAHEAAKQPPSVLCKRNKHHKGSIYCTAWSPCGELIATGSNDKTIKV 115 (350)
T ss_pred eeEEecCCCceEEeccCCceEEEEccccccCcccccccccCCCeEEeeeccccCccEEEEEecCccCeEEecCCCceEEE
Confidence 78999999999999887 8999999999999999999999998
Q ss_pred EeCCCCc-----ceEEeecCCCCeEEEEEec----CCCEEEEec-CCCeEEEEEcCCCeeeEeec---CCceeE-EEcCC
Q 040274 94 WKPTTSA-----LLIKMLYHQGPVSALAFHP----NGHLMATTG-KECKIKIWDLRKYEVLQTLT---GHAKTL-DFSQK 159 (359)
Q Consensus 94 wd~~~~~-----~~~~~~~h~~~v~~l~~~p----~g~~l~s~~-~d~~i~vwd~~~~~~~~~~~---~~v~~~-~~s~~ 159 (359)
.-.+... .-..|..|.+.|..++|-. .|.+|++++ .|..|++-|...|+.++.+. ++|.++ .|+.-
T Consensus 116 l~fn~dt~~~~g~dle~nmhdgtirdl~fld~~~s~~~il~s~gagdc~iy~tdc~~g~~~~a~sghtghilalyswn~~ 195 (350)
T KOG0641|consen 116 LPFNADTCNATGHDLEFNMHDGTIRDLAFLDDPESGGAILASAGAGDCKIYITDCGRGQGFHALSGHTGHILALYSWNGA 195 (350)
T ss_pred EecccccccccCcceeeeecCCceeeeEEecCCCcCceEEEecCCCcceEEEeecCCCCcceeecCCcccEEEEEEecCc
Confidence 8665432 2346778999999999954 356777766 47889999999999988884 456554 34322
Q ss_pred CcEEEEcCCcEEEEcCCCCCccccccccc---cCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEc
Q 040274 160 GLLAVGTGSFAQILGDFSGSHNYSRYMGN---SMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVP 222 (359)
Q Consensus 160 gl~~~~~d~~i~v~d~~~~~~~~~~~~~~---~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~ 222 (359)
-+++++.|.+|++||++-. ..+..+... .+...+.|.+++..|.|++|++|..|....+|..
T Consensus 196 m~~sgsqdktirfwdlrv~-~~v~~l~~~~~~~glessavaav~vdpsgrll~sg~~dssc~lydi 260 (350)
T KOG0641|consen 196 MFASGSQDKTIRFWDLRVN-SCVNTLDNDFHDGGLESSAVAAVAVDPSGRLLASGHADSSCMLYDI 260 (350)
T ss_pred EEEccCCCceEEEEeeecc-ceeeeccCcccCCCcccceeEEEEECCCcceeeeccCCCceEEEEe
Confidence 2778889999999997654 233332211 1113357999999999999999999987766543
No 124
>KOG4283 consensus Transcription-coupled repair protein CSA, contains WD40 domain [Transcription; Replication, recombination and repair]
Probab=99.70 E-value=7.3e-16 Score=130.22 Aligned_cols=179 Identities=15% Similarity=0.235 Sum_probs=141.9
Q ss_pred eEEEECCCCCEEEEeccceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCCc------------ceE---EeecCCCCeEEE
Q 040274 52 ILWILPSSGRYMAVAGRRTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTSA------------LLI---KMLYHQGPVSAL 115 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~------------~~~---~~~~h~~~v~~l 115 (359)
.+|.+++|-.+.-.-+..|+++.+.+ .|.++++|+.||.|-+||+.... ++. .-.+|.-.|.++
T Consensus 28 l~L~Ln~d~d~~r~HgGsvNsL~id~tegrymlSGgadgsi~v~Dl~n~t~~e~s~li~k~~c~v~~~h~~~Hky~iss~ 107 (397)
T KOG4283|consen 28 LSLQLNNDKDFVRPHGGSVNSLQIDLTEGRYMLSGGADGSIAVFDLQNATDYEASGLIAKHKCIVAKQHENGHKYAISSA 107 (397)
T ss_pred heeeccCCcceeccCCCccceeeeccccceEEeecCCCccEEEEEeccccchhhccceeheeeeccccCCccceeeeeee
Confidence 56777777766654444799999999 79999999999999999987432 110 012577789999
Q ss_pred EEec-CCCEEEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCC----cEEEEc-CCcEEEEcCCCCCcccccccc
Q 040274 116 AFHP-NGHLMATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG----LLAVGT-GSFAQILGDFSGSHNYSRYMG 187 (359)
Q Consensus 116 ~~~p-~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g----l~~~~~-d~~i~v~d~~~~~~~~~~~~~ 187 (359)
.|-| |..+|.+++-|.+++|||..+.+....| ++.|.+-+|||-. |++++. +-.|++-|+..+ .....+.+
T Consensus 108 ~WyP~DtGmFtssSFDhtlKVWDtnTlQ~a~~F~me~~VYshamSp~a~sHcLiA~gtr~~~VrLCDi~SG-s~sH~LsG 186 (397)
T KOG4283|consen 108 IWYPIDTGMFTSSSFDHTLKVWDTNTLQEAVDFKMEGKVYSHAMSPMAMSHCLIAAGTRDVQVRLCDIASG-SFSHTLSG 186 (397)
T ss_pred EEeeecCceeecccccceEEEeecccceeeEEeecCceeehhhcChhhhcceEEEEecCCCcEEEEeccCC-cceeeecc
Confidence 9999 5557888899999999999998876666 7788888998854 666655 569999997655 66777788
Q ss_pred ccCCCCcceeEEEEccCCCE-EEEEeCCCeEEEEEcCCCCCceeeeccC
Q 040274 188 NSMVKGYQIGKVSFRPYEDV-LGIGHSMGWSGILVPRSSEPNFDSWVAN 235 (359)
Q Consensus 188 ~~~~~~~~v~~~~~sp~~~~-l~~g~~dg~~~i~~~gs~~~~~~~~~~~ 235 (359)
|.. .|.++.|+|...+ |++|+.||.+++|..--..+++...+..
T Consensus 187 Hr~----~vlaV~Wsp~~e~vLatgsaDg~irlWDiRrasgcf~~lD~h 231 (397)
T KOG4283|consen 187 HRD----GVLAVEWSPSSEWVLATGSADGAIRLWDIRRASGCFRVLDQH 231 (397)
T ss_pred ccC----ceEEEEeccCceeEEEecCCCceEEEEEeecccceeEEeecc
Confidence 865 8999999998765 6899999999999887777788887754
No 125
>KOG0307 consensus Vesicle coat complex COPII, subunit SEC31 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.70 E-value=4.7e-17 Score=158.94 Aligned_cols=171 Identities=18% Similarity=0.205 Sum_probs=137.5
Q ss_pred eEEEECCCCCE----EEEecc-----------------------------ceeEEEEcC-CCCEEEEEeCCCeEEEEeCC
Q 040274 52 ILWILPSSGRY----MAVAGR-----------------------------RTDLMRVNP-FNGVVSLGHSGGTVTMWKPT 97 (359)
Q Consensus 52 ~~l~~spdg~~----l~~~~~-----------------------------~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~ 97 (359)
+.|+|++.|.. |+.|.. .|..+.|++ .+++|++|+.||.|.|||++
T Consensus 68 ~kL~W~~~g~~~~GlIaGG~edG~I~ly~p~~~~~~~~~~~la~~~~h~G~V~gLDfN~~q~nlLASGa~~geI~iWDln 147 (1049)
T KOG0307|consen 68 NKLAWGSYGSHSHGLIAGGLEDGNIVLYDPASIIANASEEVLATKSKHTGPVLGLDFNPFQGNLLASGADDGEILIWDLN 147 (1049)
T ss_pred eeeeecccCCCccceeeccccCCceEEecchhhccCcchHHHhhhcccCCceeeeeccccCCceeeccCCCCcEEEeccC
Confidence 89999988887 444433 899999999 55699999999999999998
Q ss_pred CCcceEEee--cCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCCCeeeEeec-----CCceeEEEcCCC---cEEEEc
Q 040274 98 TSALLIKML--YHQGPVSALAFHP-NGHLMATTGKECKIKIWDLRKYEVLQTLT-----GHAKTLDFSQKG---LLAVGT 166 (359)
Q Consensus 98 ~~~~~~~~~--~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~~~~~~~~~-----~~v~~~~~s~~g---l~~~~~ 166 (359)
..+.-.++. ...+.|.+++|+. ..+.|++++.+|.+.|||++..+++..+. .++..++|+|++ +++++.
T Consensus 148 n~~tP~~~~~~~~~~eI~~lsWNrkvqhILAS~s~sg~~~iWDlr~~~pii~ls~~~~~~~~S~l~WhP~~aTql~~As~ 227 (1049)
T KOG0307|consen 148 KPETPFTPGSQAPPSEIKCLSWNRKVSHILASGSPSGRAVIWDLRKKKPIIKLSDTPGRMHCSVLAWHPDHATQLLVASG 227 (1049)
T ss_pred CcCCCCCCCCCCCcccceEeccchhhhHHhhccCCCCCceeccccCCCcccccccCCCccceeeeeeCCCCceeeeeecC
Confidence 654333331 2457899999987 45568999999999999999988777662 357899999998 666665
Q ss_pred C---CcEEEEcCCCCCccccccccccCCCCcceeEEEEccCC-CEEEEEeCCCeEEEEEcCCCC
Q 040274 167 G---SFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYE-DVLGIGHSMGWSGILVPRSSE 226 (359)
Q Consensus 167 d---~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~-~~l~~g~~dg~~~i~~~gs~~ 226 (359)
| -.|.+||++........+..|.. .|.++.|++.+ .+|++++.|+.+.+|.+.+++
T Consensus 228 dd~~PviqlWDlR~assP~k~~~~H~~----GilslsWc~~D~~lllSsgkD~~ii~wN~~tgE 287 (1049)
T KOG0307|consen 228 DDSAPVIQLWDLRFASSPLKILEGHQR----GILSLSWCPQDPRLLLSSGKDNRIICWNPNTGE 287 (1049)
T ss_pred CCCCceeEeecccccCCchhhhccccc----ceeeeccCCCCchhhhcccCCCCeeEecCCCce
Confidence 4 47999999988788888877765 79999999966 889999999999888766643
No 126
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=99.69 E-value=6.2e-16 Score=137.72 Aligned_cols=163 Identities=17% Similarity=0.301 Sum_probs=133.7
Q ss_pred eEEEECCCCC-EEEEecc--------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEE
Q 040274 52 ILWILPSSGR-YMAVAGR--------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIK 104 (359)
Q Consensus 52 ~~l~~spdg~-~l~~~~~--------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~ 104 (359)
.+..|+|+|. .++++++ .+.....+|++++|+..+..|.|.+....|++.+.+
T Consensus 261 ~~a~f~p~G~~~i~~s~rrky~ysyDle~ak~~k~~~~~g~e~~~~e~FeVShd~~fia~~G~~G~I~lLhakT~eli~s 340 (514)
T KOG2055|consen 261 QKAEFAPNGHSVIFTSGRRKYLYSYDLETAKVTKLKPPYGVEEKSMERFEVSHDSNFIAIAGNNGHIHLLHAKTKELITS 340 (514)
T ss_pred ceeeecCCCceEEEecccceEEEEeeccccccccccCCCCcccchhheeEecCCCCeEEEcccCceEEeehhhhhhhhhe
Confidence 7889999999 7777777 567788899999999999999999999999999988
Q ss_pred eecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee--cCCc--eeEEEcCCC-cEE-EEcCCcEEEEcCCC-
Q 040274 105 MLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL--TGHA--KTLDFSQKG-LLA-VGTGSFAQILGDFS- 177 (359)
Q Consensus 105 ~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v--~~~~~s~~g-l~~-~~~d~~i~v~d~~~- 177 (359)
+.. .+.|..++|+.++..|+.++.+|.|++||++...+++.+ .|.+ +++|.|++| +++ |+..|.|.|||...
T Consensus 341 ~Ki-eG~v~~~~fsSdsk~l~~~~~~GeV~v~nl~~~~~~~rf~D~G~v~gts~~~S~ng~ylA~GS~~GiVNIYd~~s~ 419 (514)
T KOG2055|consen 341 FKI-EGVVSDFTFSSDSKELLASGGTGEVYVWNLRQNSCLHRFVDDGSVHGTSLCISLNGSYLATGSDSGIVNIYDGNSC 419 (514)
T ss_pred eee-ccEEeeEEEecCCcEEEEEcCCceEEEEecCCcceEEEEeecCccceeeeeecCCCceEEeccCcceEEEeccchh
Confidence 865 788999999999999999999999999999999999998 4444 788889999 555 45569999999422
Q ss_pred ----CCccccccccccCCCCcceeEEEEccCCCEEEEEeCCC--eEEE
Q 040274 178 ----GSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG--WSGI 219 (359)
Q Consensus 178 ----~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg--~~~i 219 (359)
.++++..+..... .|+++.|+||+.+|+.+|... .+++
T Consensus 420 ~~s~~PkPik~~dNLtt----~Itsl~Fn~d~qiLAiaS~~~knalrL 463 (514)
T KOG2055|consen 420 FASTNPKPIKTVDNLTT----AITSLQFNHDAQILAIASRVKKNALRL 463 (514)
T ss_pred hccCCCCchhhhhhhhe----eeeeeeeCcchhhhhhhhhccccceEE
Confidence 2334444444433 799999999999999888643 4444
No 127
>KOG0301 consensus Phospholipase A2-activating protein (contains WD40 repeats) [Lipid transport and metabolism]
Probab=99.69 E-value=8e-16 Score=143.13 Aligned_cols=142 Identities=20% Similarity=0.252 Sum_probs=108.4
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
.|+++..-|++ .++|||.|.+|++|.- ++.+.+|.+|++-|.++++-+++ .|++|+.||.|++||+ +|+++..+.
T Consensus 142 sVWAv~~l~e~-~~vTgsaDKtIklWk~--~~~l~tf~gHtD~VRgL~vl~~~-~flScsNDg~Ir~w~~-~ge~l~~~~ 216 (745)
T KOG0301|consen 142 SVWAVASLPEN-TYVTGSADKTIKLWKG--GTLLKTFSGHTDCVRGLAVLDDS-HFLSCSNDGSIRLWDL-DGEVLLEMH 216 (745)
T ss_pred heeeeeecCCC-cEEeccCcceeeeccC--CchhhhhccchhheeeeEEecCC-CeEeecCCceEEEEec-cCceeeeee
Confidence 78888888877 7889999999999974 67788888999999999988765 5778889999999998 677777774
Q ss_pred C---CceeEEE-cCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 149 G---HAKTLDF-SQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 149 ~---~v~~~~~-s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
+ .+++++. .+++ ++++|.|++++||+.. .....+ .+ ++..|+++.+-++|+ |++|++||.++||-..
T Consensus 217 ghtn~vYsis~~~~~~~Ivs~gEDrtlriW~~~---e~~q~I-~l---PttsiWsa~~L~NgD-Ivvg~SDG~VrVfT~~ 288 (745)
T KOG0301|consen 217 GHTNFVYSISMALSDGLIVSTGEDRTLRIWKKD---ECVQVI-TL---PTTSIWSAKVLLNGD-IVVGGSDGRVRVFTVD 288 (745)
T ss_pred ccceEEEEEEecCCCCeEEEecCCceEEEeecC---ceEEEE-ec---CccceEEEEEeeCCC-EEEeccCceEEEEEec
Confidence 4 4778874 4445 8888889999999843 222222 22 333688888888887 6778888888888654
No 128
>KOG2445 consensus Nuclear pore complex component (sc Seh1) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=99.69 E-value=5.3e-15 Score=125.74 Aligned_cols=163 Identities=17% Similarity=0.257 Sum_probs=121.8
Q ss_pred eEEEECCCCCEEEEecc---------------------------ceeEEEE-cC-CCCEEEEEeCCCeEEEEeCC-----
Q 040274 52 ILWILPSSGRYMAVAGR---------------------------RTDLMRV-NP-FNGVVSLGHSGGTVTMWKPT----- 97 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~---------------------------~v~~l~~-sp-~~~~l~tg~~dg~v~lwd~~----- 97 (359)
.|+.|.+.|+++|+|+. .|..+.| +| -|+.+++++.|++|.||.-.
T Consensus 17 hdVs~D~~GRRmAtCSsDq~vkI~d~~~~s~~W~~Ts~Wrah~~Si~rV~WAhPEfGqvvA~cS~Drtv~iWEE~~~~~~ 96 (361)
T KOG2445|consen 17 HDVSFDFYGRRMATCSSDQTVKIWDSTSDSGTWSCTSSWRAHDGSIWRVVWAHPEFGQVVATCSYDRTVSIWEEQEKSEE 96 (361)
T ss_pred eeeeecccCceeeeccCCCcEEEEeccCCCCceEEeeeEEecCCcEEEEEecCccccceEEEEecCCceeeeeecccccc
Confidence 78899999999999987 7889999 45 68999999999999999742
Q ss_pred C----CcceEEeecCCCCeEEEEEec--CCCEEEEecCCCeEEEEEcCC------CeeeEeec----------CCceeEE
Q 040274 98 T----SALLIKMLYHQGPVSALAFHP--NGHLMATTGKECKIKIWDLRK------YEVLQTLT----------GHAKTLD 155 (359)
Q Consensus 98 ~----~~~~~~~~~h~~~v~~l~~~p--~g~~l~s~~~d~~i~vwd~~~------~~~~~~~~----------~~v~~~~ 155 (359)
. .....++....+.|+.+.|.| -|-.||+++.||.|+||+... ..+.+.+. .+..|+.
T Consensus 97 ~~~~~Wv~~ttl~DsrssV~DV~FaP~hlGLklA~~~aDG~lRIYEA~dp~nLs~W~Lq~Ei~~~~~pp~~~~~~~~Cvs 176 (361)
T KOG2445|consen 97 AHGRRWVRRTTLVDSRSSVTDVKFAPKHLGLKLAAASADGILRIYEAPDPMNLSQWTLQHEIQNVIDPPGKNKQPCFCVS 176 (361)
T ss_pred cccceeEEEEEeecCCcceeEEEecchhcceEEEEeccCcEEEEEecCCccccccchhhhhhhhccCCcccccCcceEEe
Confidence 1 122345556778999999999 477899999999999997653 22233331 2358999
Q ss_pred EcCCC----cEEEEcCC------cEEEEcCCCCCcc---ccccccccCCCCcceeEEEEccCC----CEEEEEeCCCeEE
Q 040274 156 FSQKG----LLAVGTGS------FAQILGDFSGSHN---YSRYMGNSMVKGYQIGKVSFRPYE----DVLGIGHSMGWSG 218 (359)
Q Consensus 156 ~s~~g----l~~~~~d~------~i~v~d~~~~~~~---~~~~~~~~~~~~~~v~~~~~sp~~----~~l~~g~~dg~~~ 218 (359)
|+|.- +++++.+. .+.||........ ...+.+|. .+|++++|.|.- ..||+++.|| ++
T Consensus 177 Wn~sr~~~p~iAvgs~e~a~~~~~~~Iye~~e~~rKw~kva~L~d~~----dpI~di~wAPn~Gr~y~~lAvA~kDg-v~ 251 (361)
T KOG2445|consen 177 WNPSRMHEPLIAVGSDEDAPHLNKVKIYEYNENGRKWLKVAELPDHT----DPIRDISWAPNIGRSYHLLAVATKDG-VR 251 (361)
T ss_pred eccccccCceEEEEcccCCccccceEEEEecCCcceeeeehhcCCCC----CcceeeeeccccCCceeeEEEeecCc-EE
Confidence 99865 77777765 8888874444322 33445554 499999999953 5789999998 44
Q ss_pred E
Q 040274 219 I 219 (359)
Q Consensus 219 i 219 (359)
|
T Consensus 252 I 252 (361)
T KOG2445|consen 252 I 252 (361)
T ss_pred E
Confidence 4
No 129
>KOG0274 consensus Cdc4 and related F-box and WD-40 proteins [General function prediction only]
Probab=99.68 E-value=1.4e-15 Score=145.26 Aligned_cols=163 Identities=18% Similarity=0.269 Sum_probs=134.9
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h 108 (359)
+++++..-+.+|++|+. .|.+|... ...+++|+.|.+|++|++.++.++..+.+|
T Consensus 253 ~~l~~~~~~~~lvsgS~D~t~rvWd~~sg~C~~~l~gh~stv~~~~~~--~~~~~sgs~D~tVkVW~v~n~~~l~l~~~h 330 (537)
T KOG0274|consen 253 WGLAFPSGGDKLVSGSTDKTERVWDCSTGECTHSLQGHTSSVRCLTID--PFLLVSGSRDNTVKVWDVTNGACLNLLRGH 330 (537)
T ss_pred eeEEEecCCCEEEEEecCCcEEeEecCCCcEEEEecCCCceEEEEEcc--CceEeeccCCceEEEEeccCcceEEEeccc
Confidence 88888777888888885 45555443 447788999999999999999999999999
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecCC---ceeEEEcC-CCcEEEEcCCcEEEEcCCCCCccccc
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTGH---AKTLDFSQ-KGLLAVGTGSFAQILGDFSGSHNYSR 184 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~~---v~~~~~s~-~gl~~~~~d~~i~v~d~~~~~~~~~~ 184 (359)
.++|+++.++ +.++++|+.|++|.+||+.++++++++.+| |.++.+.+ .-+++++.|++|++||+.+.......
T Consensus 331 ~~~V~~v~~~--~~~lvsgs~d~~v~VW~~~~~~cl~sl~gH~~~V~sl~~~~~~~~~Sgs~D~~IkvWdl~~~~~c~~t 408 (537)
T KOG0274|consen 331 TGPVNCVQLD--EPLLVSGSYDGTVKVWDPRTGKCLKSLSGHTGRVYSLIVDSENRLLSGSLDTTIKVWDLRTKRKCIHT 408 (537)
T ss_pred cccEEEEEec--CCEEEEEecCceEEEEEhhhceeeeeecCCcceEEEEEecCcceEEeeeeccceEeecCCchhhhhhh
Confidence 9999999997 789999999999999999999999999665 78888888 44999999999999997655456677
Q ss_pred cccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCC
Q 040274 185 YMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRS 224 (359)
Q Consensus 185 ~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs 224 (359)
+..|.. -|.++ ...+.+|++++.|+.+.+|....
T Consensus 409 l~~h~~----~v~~l--~~~~~~Lvs~~aD~~Ik~WD~~~ 442 (537)
T KOG0274|consen 409 LQGHTS----LVSSL--LLRDNFLVSSSADGTIKLWDAEE 442 (537)
T ss_pred hcCCcc----ccccc--ccccceeEeccccccEEEeeccc
Confidence 777754 45444 44788999999999999985433
No 130
>KOG0647 consensus mRNA export protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.68 E-value=1e-15 Score=129.72 Aligned_cols=143 Identities=16% Similarity=0.239 Sum_probs=108.1
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCC-Ccce-EEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeE
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTT-SALL-IKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQ 145 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~-~~~~-~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~ 145 (359)
.|.+|+||| ...++++||.||+|++|++.. +..+ .....|.++|.+++|+.||..+++|+.|+.+++||+.+++...
T Consensus 29 sIS~l~FSP~~~~~~~A~SWD~tVR~wevq~~g~~~~ka~~~~~~PvL~v~WsddgskVf~g~~Dk~~k~wDL~S~Q~~~ 108 (347)
T KOG0647|consen 29 SISALAFSPQADNLLAAGSWDGTVRIWEVQNSGQLVPKAQQSHDGPVLDVCWSDDGSKVFSGGCDKQAKLWDLASGQVSQ 108 (347)
T ss_pred chheeEeccccCceEEecccCCceEEEEEecCCcccchhhhccCCCeEEEEEccCCceEEeeccCCceEEEEccCCCeee
Confidence 799999999 566788999999999999986 3333 3345799999999999999999999999999999999997643
Q ss_pred --eecCCceeEEEcCCC----cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 146 --TLTGHAKTLDFSQKG----LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 146 --~~~~~v~~~~~s~~g----l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
...++|.++.|-+.. |+++++|.+|+.||++.. .++..+.-.. .|+++.. -...++++..+..+.+
T Consensus 109 v~~Hd~pvkt~~wv~~~~~~cl~TGSWDKTlKfWD~R~~-~pv~t~~LPe-----RvYa~Dv--~~pm~vVata~r~i~v 180 (347)
T KOG0647|consen 109 VAAHDAPVKTCHWVPGMNYQCLVTGSWDKTLKFWDTRSS-NPVATLQLPE-----RVYAADV--LYPMAVVATAERHIAV 180 (347)
T ss_pred eeecccceeEEEEecCCCcceeEecccccceeecccCCC-Ceeeeeeccc-----eeeehhc--cCceeEEEecCCcEEE
Confidence 337889999997765 689999999999997654 3333332221 4555544 3345555555554443
No 131
>KOG1007 consensus WD repeat protein TSSC1, WD repeat superfamily [Function unknown]
Probab=99.68 E-value=1.2e-15 Score=128.49 Aligned_cols=151 Identities=19% Similarity=0.352 Sum_probs=122.2
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcc-eEEee-----cCCCCeEEEEEec--CCCEEEEecCCCeEEEEEcCC
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSAL-LIKML-----YHQGPVSALAFHP--NGHLMATTGKECKIKIWDLRK 140 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~-~~~~~-----~h~~~v~~l~~~p--~g~~l~s~~~d~~i~vwd~~~ 140 (359)
.|.|+.|.|++..+++-. |..|.+|++..+.. +..+. .|....++-+|+| +|+.+++. .|+++..||+|+
T Consensus 125 ~i~cvew~Pns~klasm~-dn~i~l~~l~ess~~vaev~ss~s~e~~~~ftsg~WspHHdgnqv~tt-~d~tl~~~D~RT 202 (370)
T KOG1007|consen 125 KINCVEWEPNSDKLASMD-DNNIVLWSLDESSKIVAEVLSSESAEMRHSFTSGAWSPHHDGNQVATT-SDSTLQFWDLRT 202 (370)
T ss_pred ceeeEEEcCCCCeeEEec-cCceEEEEcccCcchheeecccccccccceecccccCCCCccceEEEe-CCCcEEEEEccc
Confidence 689999999888887775 78999999987654 33222 3566788899999 77777665 678999999999
Q ss_pred CeeeEee-cCC---ceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCC-CEEEEEe
Q 040274 141 YEVLQTL-TGH---AKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYE-DVLGIGH 212 (359)
Q Consensus 141 ~~~~~~~-~~~---v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~-~~l~~g~ 212 (359)
......+ ..| +.+++|+|+- +++++.||.|+|||++....++..+..|.. .|+++.|+|.- .+|++|+
T Consensus 203 ~~~~~sI~dAHgq~vrdlDfNpnkq~~lvt~gDdgyvriWD~R~tk~pv~el~~HsH----WvW~VRfn~~hdqLiLs~~ 278 (370)
T KOG1007|consen 203 MKKNNSIEDAHGQRVRDLDFNPNKQHILVTCGDDGYVRIWDTRKTKFPVQELPGHSH----WVWAVRFNPEHDQLILSGG 278 (370)
T ss_pred hhhhcchhhhhcceeeeccCCCCceEEEEEcCCCccEEEEeccCCCccccccCCCce----EEEEEEecCccceEEEecC
Confidence 8877777 334 7999999987 788889999999999888888888888865 99999999954 6678888
Q ss_pred CCCeEEEEEcCCC
Q 040274 213 SMGWSGILVPRSS 225 (359)
Q Consensus 213 ~dg~~~i~~~gs~ 225 (359)
.|..+.++..++.
T Consensus 279 SDs~V~Lsca~sv 291 (370)
T KOG1007|consen 279 SDSAVNLSCASSV 291 (370)
T ss_pred CCceeEEEecccc
Confidence 8988888766543
No 132
>KOG0301 consensus Phospholipase A2-activating protein (contains WD40 repeats) [Lipid transport and metabolism]
Probab=99.68 E-value=1e-15 Score=142.34 Aligned_cols=155 Identities=16% Similarity=0.209 Sum_probs=131.4
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
.|.|++...++. +++||.|.++++|-+. ++...+.+|+..|+++..-|++ .++|||.|.+|++|.- ++++++|.
T Consensus 103 nVC~ls~~~~~~-~iSgSWD~TakvW~~~--~l~~~l~gH~asVWAv~~l~e~-~~vTgsaDKtIklWk~--~~~l~tf~ 176 (745)
T KOG0301|consen 103 NVCSLSIGEDGT-LISGSWDSTAKVWRIG--ELVYSLQGHTASVWAVASLPEN-TYVTGSADKTIKLWKG--GTLLKTFS 176 (745)
T ss_pred ceeeeecCCcCc-eEecccccceEEecch--hhhcccCCcchheeeeeecCCC-cEEeccCcceeeeccC--Cchhhhhc
Confidence 677777766666 9999999999999764 6677799999999999999987 8899999999999976 67788886
Q ss_pred CC---ceeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEE----
Q 040274 149 GH---AKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGIL---- 220 (359)
Q Consensus 149 ~~---v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~---- 220 (359)
+| |..+++-+++ +++++.||.|++|++ .+ ..+..+.+|.. -|++++..+++..++++++|+.++||
T Consensus 177 gHtD~VRgL~vl~~~~flScsNDg~Ir~w~~-~g-e~l~~~~ghtn----~vYsis~~~~~~~Ivs~gEDrtlriW~~~e 250 (745)
T KOG0301|consen 177 GHTDCVRGLAVLDDSHFLSCSNDGSIRLWDL-DG-EVLLEMHGHTN----FVYSISMALSDGLIVSTGEDRTLRIWKKDE 250 (745)
T ss_pred cchhheeeeEEecCCCeEeecCCceEEEEec-cC-ceeeeeeccce----EEEEEEecCCCCeEEEecCCceEEEeecCc
Confidence 65 7889999996 999999999999996 33 56666777754 79999988999999999999998883
Q ss_pred -----------------------EcCCCCCceeeeccC
Q 040274 221 -----------------------VPRSSEPNFDSWVAN 235 (359)
Q Consensus 221 -----------------------~~gs~~~~~~~~~~~ 235 (359)
+.|+.|+.+++|...
T Consensus 251 ~~q~I~lPttsiWsa~~L~NgDIvvg~SDG~VrVfT~~ 288 (745)
T KOG0301|consen 251 CVQVITLPTTSIWSAKVLLNGDIVVGGSDGRVRVFTVD 288 (745)
T ss_pred eEEEEecCccceEEEEEeeCCCEEEeccCceEEEEEec
Confidence 567778888888654
No 133
>KOG1274 consensus WD40 repeat protein [General function prediction only]
Probab=99.68 E-value=1.7e-15 Score=144.99 Aligned_cols=159 Identities=15% Similarity=0.248 Sum_probs=131.2
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeec-
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLY- 107 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~- 107 (359)
.+++++-+|.++|.|+. +|.++.|+|.+.+||+.+.||.|++||+.++....++.+
T Consensus 100 r~~~v~g~g~~iaagsdD~~vK~~~~~D~s~~~~lrgh~apVl~l~~~p~~~fLAvss~dG~v~iw~~~~~~~~~tl~~v 179 (933)
T KOG1274|consen 100 RDLAVSGSGKMIAAGSDDTAVKLLNLDDSSQEKVLRGHDAPVLQLSYDPKGNFLAVSSCDGKVQIWDLQDGILSKTLTGV 179 (933)
T ss_pred eEEEEecCCcEEEeecCceeEEEEeccccchheeecccCCceeeeeEcCCCCEEEEEecCceEEEEEcccchhhhhcccC
Confidence 88999999999999998 899999999999999999999999999998876665542
Q ss_pred -------CCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec-----CCceeEEEcCCC--cEEEEcCCcEEEE
Q 040274 108 -------HQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT-----GHAKTLDFSQKG--LLAVGTGSFAQIL 173 (359)
Q Consensus 108 -------h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~-----~~v~~~~~s~~g--l~~~~~d~~i~v~ 173 (359)
....+.-++|+|+|..|+..+.|+.|++|+...+.....+. ..+.+++|+|.| +++++.+|.|.||
T Consensus 180 ~k~n~~~~s~i~~~~aW~Pk~g~la~~~~d~~Vkvy~r~~we~~f~Lr~~~~ss~~~~~~wsPnG~YiAAs~~~g~I~vW 259 (933)
T KOG1274|consen 180 DKDNEFILSRICTRLAWHPKGGTLAVPPVDNTVKVYSRKGWELQFKLRDKLSSSKFSDLQWSPNGKYIAASTLDGQILVW 259 (933)
T ss_pred CccccccccceeeeeeecCCCCeEEeeccCCeEEEEccCCceeheeecccccccceEEEEEcCCCcEEeeeccCCcEEEE
Confidence 13467789999999899999999999999999998887772 237899999999 5666679999999
Q ss_pred cCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 174 GDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 174 d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
|+.+. ..|. ....|++++|.|+++.|-.-...|+..+
T Consensus 260 nv~t~-------~~~~--~~~~Vc~~aw~p~~n~it~~~~~g~~~~ 296 (933)
T KOG1274|consen 260 NVDTH-------ERHE--FKRAVCCEAWKPNANAITLITALGTLGV 296 (933)
T ss_pred ecccc-------hhcc--ccceeEEEecCCCCCeeEEEeecccccc
Confidence 97542 1132 3447999999999988776666665444
No 134
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.67 E-value=1e-15 Score=126.11 Aligned_cols=147 Identities=17% Similarity=0.238 Sum_probs=112.7
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCC---cceEEeecCCCCeEEEEEec--CCCEEEEecCCCeEEEEEcCCCee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTS---ALLIKMLYHQGPVSALAFHP--NGHLMATTGKECKIKIWDLRKYEV 143 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~---~~~~~~~~h~~~v~~l~~~p--~g~~l~s~~~d~~i~vwd~~~~~~ 143 (359)
.|+....+-.|..|+|++.|++|+|+..+.. ..+..+.+|.+||+-++|.. -|.+||+++.||.|.||.-..+.-
T Consensus 13 ~IHda~lDyygkrlATcsSD~tVkIf~v~~n~~s~ll~~L~Gh~GPVwqv~wahPk~G~iLAScsYDgkVIiWke~~g~w 92 (299)
T KOG1332|consen 13 MIHDAQLDYYGKRLATCSSDGTVKIFEVRNNGQSKLLAELTGHSGPVWKVAWAHPKFGTILASCSYDGKVIIWKEENGRW 92 (299)
T ss_pred hhhHhhhhhhcceeeeecCCccEEEEEEcCCCCceeeeEecCCCCCeeEEeecccccCcEeeEeecCceEEEEecCCCch
Confidence 4566666778999999999999999998754 45778899999999999954 799999999999999999887743
Q ss_pred e--Eee---cCCceeEEEcCCC----cEEEEcCCcEEEEcCCCC-Ccc-ccccccccCCCCcceeEEEEccC---C----
Q 040274 144 L--QTL---TGHAKTLDFSQKG----LLAVGTGSFAQILGDFSG-SHN-YSRYMGNSMVKGYQIGKVSFRPY---E---- 205 (359)
Q Consensus 144 ~--~~~---~~~v~~~~~s~~g----l~~~~~d~~i~v~d~~~~-~~~-~~~~~~~~~~~~~~v~~~~~sp~---~---- 205 (359)
. +.+ ...|++++|.|.+ |++++.||.|.|++.... ... ......|.. .|++++|.|- |
T Consensus 93 ~k~~e~~~h~~SVNsV~wapheygl~LacasSDG~vsvl~~~~~g~w~t~ki~~aH~~----GvnsVswapa~~~g~~~~ 168 (299)
T KOG1332|consen 93 TKAYEHAAHSASVNSVAWAPHEYGLLLACASSDGKVSVLTYDSSGGWTTSKIVFAHEI----GVNSVSWAPASAPGSLVD 168 (299)
T ss_pred hhhhhhhhhcccceeecccccccceEEEEeeCCCcEEEEEEcCCCCccchhhhhcccc----ccceeeecCcCCCccccc
Confidence 2 222 5679999999987 677888999999885544 222 223344543 7999999996 5
Q ss_pred -------CEEEEEeCCCeEEE
Q 040274 206 -------DVLGIGHSMGWSGI 219 (359)
Q Consensus 206 -------~~l~~g~~dg~~~i 219 (359)
..|++|+.|..+.|
T Consensus 169 ~~~~~~~krlvSgGcDn~Vki 189 (299)
T KOG1332|consen 169 QGPAAKVKRLVSGGCDNLVKI 189 (299)
T ss_pred cCcccccceeeccCCccceee
Confidence 33666666666555
No 135
>KOG0267 consensus Microtubule severing protein katanin p80 subunit B (contains WD40 repeats) [Cell cycle control, cell division, chromosome partitioning]
Probab=99.67 E-value=1.2e-16 Score=149.07 Aligned_cols=161 Identities=17% Similarity=0.282 Sum_probs=137.8
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h 108 (359)
-|+.|+++..+|+.|.. .+.++.|+|.+.+++.|+.|+.+.+||++...|...+.+|
T Consensus 74 eSl~f~~~E~LlaagsasgtiK~wDleeAk~vrtLtgh~~~~~sv~f~P~~~~~a~gStdtd~~iwD~Rk~Gc~~~~~s~ 153 (825)
T KOG0267|consen 74 ESLTFDTSERLLAAGSASGTIKVWDLEEAKIVRTLTGHLLNITSVDFHPYGEFFASGSTDTDLKIWDIRKKGCSHTYKSH 153 (825)
T ss_pred eeeecCcchhhhcccccCCceeeeehhhhhhhhhhhccccCcceeeeccceEEeccccccccceehhhhccCceeeecCC
Confidence 78888888888887765 7889999999999999999999999999988899999999
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec---CCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCcccc
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT---GHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYS 183 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~---~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~ 183 (359)
...|.++.|+|+|+++++++.|.+++|||...|+.+..|. +.+.++.|+|.. +..|+.|+++.+||+.+- ..+.
T Consensus 154 ~~vv~~l~lsP~Gr~v~~g~ed~tvki~d~~agk~~~ef~~~e~~v~sle~hp~e~Lla~Gs~d~tv~f~dletf-e~I~ 232 (825)
T KOG0267|consen 154 TRVVDVLRLSPDGRWVASGGEDNTVKIWDLTAGKLSKEFKSHEGKVQSLEFHPLEVLLAPGSSDRTVRFWDLETF-EVIS 232 (825)
T ss_pred cceeEEEeecCCCceeeccCCcceeeeecccccccccccccccccccccccCchhhhhccCCCCceeeeecccee-EEee
Confidence 9999999999999999999999999999999999998886 668999999988 667888999999997533 2222
Q ss_pred ccccccCCCCcceeEEEEccCCCEEEEEeCCCeE
Q 040274 184 RYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWS 217 (359)
Q Consensus 184 ~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~ 217 (359)
..... ...|.++.|+|++..+++|......
T Consensus 233 s~~~~----~~~v~~~~fn~~~~~~~~G~q~sl~ 262 (825)
T KOG0267|consen 233 SGKPE----TDGVRSLAFNPDGKIVLSGEQISLS 262 (825)
T ss_pred ccCCc----cCCceeeeecCCceeeecCchhhhh
Confidence 22222 2369999999999999988876644
No 136
>KOG1445 consensus Tumor-specific antigen (contains WD repeats) [Cytoskeleton]
Probab=99.66 E-value=6.8e-16 Score=142.26 Aligned_cols=163 Identities=14% Similarity=0.241 Sum_probs=132.9
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCC-------cceEEeecCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcC
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTS-------ALLIKMLYHQGPVSALAFHP-NGHLMATTGKECKIKIWDLR 139 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~-------~~~~~~~~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~ 139 (359)
.|+.+.|+| |...|++++.||.|++|.+..+ ++...+.+|...|+++.|+| ....|++++.|.+|++||++
T Consensus 629 ~vtDl~WdPFD~~rLAVa~ddg~i~lWr~~a~gl~e~~~tPe~~lt~h~eKI~slRfHPLAadvLa~asyd~Ti~lWDl~ 708 (1012)
T KOG1445|consen 629 LVTDLHWDPFDDERLAVATDDGQINLWRLTANGLPENEMTPEKILTIHGEKITSLRFHPLAADVLAVASYDSTIELWDLA 708 (1012)
T ss_pred eeeecccCCCChHHeeecccCceEEEEEeccCCCCcccCCcceeeecccceEEEEEecchhhhHhhhhhccceeeeeehh
Confidence 799999999 7889999999999999998643 45667889999999999999 45689999999999999999
Q ss_pred CCeeeEee---cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 140 KYEVLQTL---TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 140 ~~~~~~~~---~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
++.....+ .+.|.+++|||+| +.+++.||+|+||..+.....+..-.+. -+..-..+.|.-+|+++++.+.|
T Consensus 709 ~~~~~~~l~gHtdqIf~~AWSpdGr~~AtVcKDg~~rVy~Prs~e~pv~Eg~gp---vgtRgARi~wacdgr~viv~Gfd 785 (1012)
T KOG1445|consen 709 NAKLYSRLVGHTDQIFGIAWSPDGRRIATVCKDGTLRVYEPRSREQPVYEGKGP---VGTRGARILWACDGRIVIVVGFD 785 (1012)
T ss_pred hhhhhheeccCcCceeEEEECCCCcceeeeecCceEEEeCCCCCCCccccCCCC---ccCcceeEEEEecCcEEEEeccc
Confidence 98776666 4568999999999 8899999999999977665544433333 23345667888899999888777
Q ss_pred CeE--------------------------------------EEEEcCCCCCceeeecc
Q 040274 215 GWS--------------------------------------GILVPRSSEPNFDSWVA 234 (359)
Q Consensus 215 g~~--------------------------------------~i~~~gs~~~~~~~~~~ 234 (359)
... .++++|.||..+..|++
T Consensus 786 k~SeRQv~~Y~Aq~l~~~pl~t~~lDvaps~LvP~YD~Ds~~lfltGKGD~~v~~yEv 843 (1012)
T KOG1445|consen 786 KSSERQVQMYDAQTLDLRPLYTQVLDVAPSPLVPHYDYDSNVLFLTGKGDRFVNMYEV 843 (1012)
T ss_pred ccchhhhhhhhhhhccCCcceeeeecccCccccccccCCCceEEEecCCCceEEEEEe
Confidence 641 13788999999888865
No 137
>KOG1539 consensus WD repeat protein [General function prediction only]
Probab=99.66 E-value=1.7e-15 Score=143.62 Aligned_cols=164 Identities=15% Similarity=0.211 Sum_probs=138.7
Q ss_pred eEEEECCCCCEEEEecc--------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEe
Q 040274 52 ILWILPSSGRYMAVAGR--------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKM 105 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~--------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~ 105 (359)
.+++.++-|++.++|.. +|+.++...-++.+++++.+|.+.+||......+..+
T Consensus 452 ~av~vs~CGNF~~IG~S~G~Id~fNmQSGi~r~sf~~~~ah~~~V~gla~D~~n~~~vsa~~~Gilkfw~f~~k~l~~~l 531 (910)
T KOG1539|consen 452 TAVCVSFCGNFVFIGYSKGTIDRFNMQSGIHRKSFGDSPAHKGEVTGLAVDGTNRLLVSAGADGILKFWDFKKKVLKKSL 531 (910)
T ss_pred EEEEEeccCceEEEeccCCeEEEEEcccCeeecccccCccccCceeEEEecCCCceEEEccCcceEEEEecCCcceeeee
Confidence 78889999999988765 8999999988999999999999999999988777666
Q ss_pred ecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec---CCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCc
Q 040274 106 LYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT---GHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSH 180 (359)
Q Consensus 106 ~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~---~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~ 180 (359)
.- ...+.++.++....+++.+..|-.|.++|+.+.+.++.+. +.+++++||||| +++++.|++|++||+.++ .
T Consensus 532 ~l-~~~~~~iv~hr~s~l~a~~~ddf~I~vvD~~t~kvvR~f~gh~nritd~~FS~DgrWlisasmD~tIr~wDlpt~-~ 609 (910)
T KOG1539|consen 532 RL-GSSITGIVYHRVSDLLAIALDDFSIRVVDVVTRKVVREFWGHGNRITDMTFSPDGRWLISASMDSTIRTWDLPTG-T 609 (910)
T ss_pred cc-CCCcceeeeeehhhhhhhhcCceeEEEEEchhhhhhHHhhccccceeeeEeCCCCcEEEEeecCCcEEEEeccCc-c
Confidence 53 4557788888888899999999999999999988888885 458999999999 889999999999998766 4
Q ss_pred cccccccccCCCCcceeEEEEccCCCEEEEEeCCC-eEEEEEc
Q 040274 181 NYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG-WSGILVP 222 (359)
Q Consensus 181 ~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg-~~~i~~~ 222 (359)
.+..+.-. .++.++.|+|+|++||+.+.|. -+.+|..
T Consensus 610 lID~~~vd-----~~~~sls~SPngD~LAT~Hvd~~gIylWsN 647 (910)
T KOG1539|consen 610 LIDGLLVD-----SPCTSLSFSPNGDFLATVHVDQNGIYLWSN 647 (910)
T ss_pred eeeeEecC-----CcceeeEECCCCCEEEEEEecCceEEEEEc
Confidence 44444333 3789999999999999999984 4677754
No 138
>KOG2445 consensus Nuclear pore complex component (sc Seh1) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=99.65 E-value=1.2e-14 Score=123.63 Aligned_cols=146 Identities=16% Similarity=0.229 Sum_probs=109.9
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCC----cceEEeecCCCCeEEEEEec--CCCEEEEecCCCeEEEEEcCC--
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTS----ALLIKMLYHQGPVSALAFHP--NGHLMATTGKECKIKIWDLRK-- 140 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~----~~~~~~~~h~~~v~~l~~~p--~g~~l~s~~~d~~i~vwd~~~-- 140 (359)
-|+|+.|++.|..+++|+.|++|.|||.+.. .+......|.+.|..+.|.+ -|..+|+++.|+++.||.=..
T Consensus 15 lihdVs~D~~GRRmAtCSsDq~vkI~d~~~~s~~W~~Ts~Wrah~~Si~rV~WAhPEfGqvvA~cS~Drtv~iWEE~~~~ 94 (361)
T KOG2445|consen 15 LIHDVSFDFYGRRMATCSSDQTVKIWDSTSDSGTWSCTSSWRAHDGSIWRVVWAHPEFGQVVATCSYDRTVSIWEEQEKS 94 (361)
T ss_pred eeeeeeecccCceeeeccCCCcEEEEeccCCCCceEEeeeEEecCCcEEEEEecCccccceEEEEecCCceeeeeecccc
Confidence 4889999999999999999999999996533 45566789999999999954 588999999999999996421
Q ss_pred -------CeeeEee---cCCceeEEEcCCC----cEEEEcCCcEEEEcCCCCCccccccc--------cccCCCCcceeE
Q 040274 141 -------YEVLQTL---TGHAKTLDFSQKG----LLAVGTGSFAQILGDFSGSHNYSRYM--------GNSMVKGYQIGK 198 (359)
Q Consensus 141 -------~~~~~~~---~~~v~~~~~s~~g----l~~~~~d~~i~v~d~~~~~~~~~~~~--------~~~~~~~~~v~~ 198 (359)
.....++ .+.|+++.|.|.. +++++.||+++||+.........-.. ...+.+..+..|
T Consensus 95 ~~~~~~~Wv~~ttl~DsrssV~DV~FaP~hlGLklA~~~aDG~lRIYEA~dp~nLs~W~Lq~Ei~~~~~pp~~~~~~~~C 174 (361)
T KOG2445|consen 95 EEAHGRRWVRRTTLVDSRSSVTDVKFAPKHLGLKLAAASADGILRIYEAPDPMNLSQWTLQHEIQNVIDPPGKNKQPCFC 174 (361)
T ss_pred cccccceeEEEEEeecCCcceeEEEecchhcceEEEEeccCcEEEEEecCCccccccchhhhhhhhccCCcccccCcceE
Confidence 1123333 4679999999975 78888999999999654422211111 111124457899
Q ss_pred EEEccC---CCEEEEEeCC
Q 040274 199 VSFRPY---EDVLGIGHSM 214 (359)
Q Consensus 199 ~~~sp~---~~~l~~g~~d 214 (359)
+.|+|. ..+|++|+.+
T Consensus 175 vsWn~sr~~~p~iAvgs~e 193 (361)
T KOG2445|consen 175 VSWNPSRMHEPLIAVGSDE 193 (361)
T ss_pred EeeccccccCceEEEEccc
Confidence 999984 4788888887
No 139
>KOG1408 consensus WD40 repeat protein [Function unknown]
Probab=99.65 E-value=2.9e-15 Score=139.90 Aligned_cols=166 Identities=14% Similarity=0.169 Sum_probs=132.2
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcC---CCCEEEEEeCCCeEEEEeCCCC-cceEE
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNP---FNGVVSLGHSGGTVTMWKPTTS-ALLIK 104 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp---~~~~l~tg~~dg~v~lwd~~~~-~~~~~ 104 (359)
.++++||+|++||+|.. .|.|+.|+- ..++|++++.|..|+|||+... .++.+
T Consensus 463 R~~~vSp~gqhLAsGDr~GnlrVy~Lq~l~~~~~~eAHesEilcLeyS~p~~~~kLLASasrdRlIHV~Dv~rny~l~qt 542 (1080)
T KOG1408|consen 463 RALAVSPDGQHLASGDRGGNLRVYDLQELEYTCFMEAHESEILCLEYSFPVLTNKLLASASRDRLIHVYDVKRNYDLVQT 542 (1080)
T ss_pred EEEEECCCcceecccCccCceEEEEehhhhhhhheecccceeEEEeecCchhhhHhhhhccCCceEEEEecccccchhhh
Confidence 89999999999999876 799999975 3578999999999999997532 44455
Q ss_pred eecCCCCeEEEE-------------------------------------------------EecCCCEEEEecCCCeEEE
Q 040274 105 MLYHQGPVSALA-------------------------------------------------FHPNGHLMATTGKECKIKI 135 (359)
Q Consensus 105 ~~~h~~~v~~l~-------------------------------------------------~~p~g~~l~s~~~d~~i~v 135 (359)
+.+|...|+++. +.|+..++++++.|.+|+|
T Consensus 543 ld~HSssITsvKFa~~gln~~MiscGADksimFr~~qk~~~g~~f~r~t~t~~ktTlYDm~Vdp~~k~v~t~cQDrniri 622 (1080)
T KOG1408|consen 543 LDGHSSSITSVKFACNGLNRKMISCGADKSIMFRVNQKASSGRLFPRHTQTLSKTTLYDMAVDPTSKLVVTVCQDRNIRI 622 (1080)
T ss_pred hcccccceeEEEEeecCCceEEEeccCchhhheehhccccCceeccccccccccceEEEeeeCCCcceEEEEecccceEE
Confidence 555655555544 4455558899999999999
Q ss_pred EEcCCCeeeEeec------CCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCE
Q 040274 136 WDLRKYEVLQTLT------GHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDV 207 (359)
Q Consensus 136 wd~~~~~~~~~~~------~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~ 207 (359)
||+.+++.+..|. |..--+...|.| +++.+.|.++.+||...+ +.+....+|.. .|+.+.|.+|.+.
T Consensus 623 f~i~sgKq~k~FKgs~~~eG~lIKv~lDPSgiY~atScsdktl~~~Df~sg-EcvA~m~GHsE----~VTG~kF~nDCkH 697 (1080)
T KOG1408|consen 623 FDIESGKQVKSFKGSRDHEGDLIKVILDPSGIYLATSCSDKTLCFVDFVSG-ECVAQMTGHSE----AVTGVKFLNDCKH 697 (1080)
T ss_pred EeccccceeeeecccccCCCceEEEEECCCccEEEEeecCCceEEEEeccc-hhhhhhcCcch----heeeeeecccchh
Confidence 9999999999993 345668889999 555667899999996554 67777777754 8999999999999
Q ss_pred EEEEeCCCeEEEEEc
Q 040274 208 LGIGHSMGWSGILVP 222 (359)
Q Consensus 208 l~~g~~dg~~~i~~~ 222 (359)
|++.+.||.|-||--
T Consensus 698 lISvsgDgCIFvW~l 712 (1080)
T KOG1408|consen 698 LISVSGDGCIFVWKL 712 (1080)
T ss_pred heeecCCceEEEEEC
Confidence 999998886666643
No 140
>KOG0303 consensus Actin-binding protein Coronin, contains WD40 repeats [Cytoskeleton]
Probab=99.64 E-value=9.3e-15 Score=128.03 Aligned_cols=172 Identities=18% Similarity=0.207 Sum_probs=136.2
Q ss_pred eEEEECC-CCCEEEEecc------------------------------ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCC
Q 040274 52 ILWILPS-SGRYMAVAGR------------------------------RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTS 99 (359)
Q Consensus 52 ~~l~~sp-dg~~l~~~~~------------------------------~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~ 99 (359)
.+++|+| +...||+|+. .|.-++||| -.+.|++++.|.+|.+|++.|+
T Consensus 85 LDi~w~PfnD~vIASgSeD~~v~vW~IPe~~l~~~ltepvv~L~gH~rrVg~V~wHPtA~NVLlsag~Dn~v~iWnv~tg 164 (472)
T KOG0303|consen 85 LDIDWCPFNDCVIASGSEDTKVMVWQIPENGLTRDLTEPVVELYGHQRRVGLVQWHPTAPNVLLSAGSDNTVSIWNVGTG 164 (472)
T ss_pred cccccCccCCceeecCCCCceEEEEECCCcccccCcccceEEEeecceeEEEEeecccchhhHhhccCCceEEEEeccCC
Confidence 7888988 6666777776 788999999 4578999999999999999999
Q ss_pred cceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecCC----ceeEEEcCCC-cEEEEc----CCcE
Q 040274 100 ALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTGH----AKTLDFSQKG-LLAVGT----GSFA 170 (359)
Q Consensus 100 ~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~~----v~~~~~s~~g-l~~~~~----d~~i 170 (359)
+.+.++. |.+.|++++|+.||.+|+|++.|..|+|||.++++.+..-.+| ...+.|-.+| +++.+. +..+
T Consensus 165 eali~l~-hpd~i~S~sfn~dGs~l~TtckDKkvRv~dpr~~~~v~e~~~heG~k~~Raifl~~g~i~tTGfsr~seRq~ 243 (472)
T KOG0303|consen 165 EALITLD-HPDMVYSMSFNRDGSLLCTTCKDKKVRVIDPRRGTVVSEGVAHEGAKPARAIFLASGKIFTTGFSRMSERQI 243 (472)
T ss_pred ceeeecC-CCCeEEEEEeccCCceeeeecccceeEEEcCCCCcEeeecccccCCCcceeEEeccCceeeeccccccccce
Confidence 9988886 9999999999999999999999999999999999998877433 4667788888 777664 5689
Q ss_pred EEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEE-EEeCCCeEEEEEcCCCCC
Q 040274 171 QILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLG-IGHSMGWSGILVPRSSEP 227 (359)
Q Consensus 171 ~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~-~g~~dg~~~i~~~gs~~~ 227 (359)
-+||..+-........-. .++.|.---|.||..+++ +|-.|+.|+.|-.....+
T Consensus 244 aLwdp~nl~eP~~~~elD---tSnGvl~PFyD~dt~ivYl~GKGD~~IRYyEit~d~P 298 (472)
T KOG0303|consen 244 ALWDPNNLEEPIALQELD---TSNGVLLPFYDPDTSIVYLCGKGDSSIRYFEITNEPP 298 (472)
T ss_pred eccCcccccCcceeEEec---cCCceEEeeecCCCCEEEEEecCCcceEEEEecCCCc
Confidence 999965544432222111 334577778999888775 556789998876655544
No 141
>KOG0300 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.64 E-value=1.2e-15 Score=130.14 Aligned_cols=163 Identities=17% Similarity=0.250 Sum_probs=136.1
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEc------CC--
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDL------RK-- 140 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~------~~-- 140 (359)
.|+.++......++.+++.|.+.+||.+.++.|+..+.+|.+.|+++.|++.+.++++++.|++..||.. ..
T Consensus 150 GiW~Vaa~~tqpi~gtASADhTA~iWs~Esg~CL~~Y~GH~GSVNsikfh~s~~L~lTaSGD~taHIW~~av~~~vP~~~ 229 (481)
T KOG0300|consen 150 GIWHVAADSTQPICGTASADHTARIWSLESGACLATYTGHTGSVNSIKFHNSGLLLLTASGDETAHIWKAAVNWEVPSNN 229 (481)
T ss_pred ceeeehhhcCCcceeecccccceeEEeeccccceeeecccccceeeEEeccccceEEEccCCcchHHHHHhhcCcCCCCC
Confidence 6777777666668999999999999999999999999999999999999999999999999999999962 10
Q ss_pred ----------------------------C----eeeEeecC---CceeEEEcCCC--cEEEEcCCcEEEEcCCCCCcccc
Q 040274 141 ----------------------------Y----EVLQTLTG---HAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYS 183 (359)
Q Consensus 141 ----------------------------~----~~~~~~~~---~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~ 183 (359)
+ .++..+.+ .|.++.|-..| ++++++|.+..+||+.++ ..+.
T Consensus 230 a~~~hSsEeE~e~sDe~~~d~d~~~~sD~~tiRvPl~~ltgH~~vV~a~dWL~gg~Q~vTaSWDRTAnlwDVEtg-e~v~ 308 (481)
T KOG0300|consen 230 APSDHSSEEEEEHSDEHNRDTDSSEKSDGHTIRVPLMRLTGHRAVVSACDWLAGGQQMVTASWDRTANLWDVETG-EVVN 308 (481)
T ss_pred CCCCCCchhhhhcccccccccccccccCCceeeeeeeeeeccccceEehhhhcCcceeeeeeccccceeeeeccC-ceec
Confidence 0 01222223 35777887777 999999999999997665 7788
Q ss_pred ccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE------------------------------EEcCCCCCceeeec
Q 040274 184 RYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI------------------------------LVPRSSEPNFDSWV 233 (359)
Q Consensus 184 ~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i------------------------------~~~gs~~~~~~~~~ 233 (359)
.+.+|.. ..+.++-+|..+++++++.|...++ +++|++|.++++|+
T Consensus 309 ~LtGHd~----ELtHcstHptQrLVvTsSrDtTFRLWDFReaI~sV~VFQGHtdtVTS~vF~~dd~vVSgSDDrTvKvWd 384 (481)
T KOG0300|consen 309 ILTGHDS----ELTHCSTHPTQRLVVTSSRDTTFRLWDFREAIQSVAVFQGHTDTVTSVVFNTDDRVVSGSDDRTVKVWD 384 (481)
T ss_pred cccCcch----hccccccCCcceEEEEeccCceeEeccchhhcceeeeecccccceeEEEEecCCceeecCCCceEEEee
Confidence 8888865 7888999999999999999988666 58899999999999
Q ss_pred cCC
Q 040274 234 ANP 236 (359)
Q Consensus 234 ~~~ 236 (359)
...
T Consensus 385 LrN 387 (481)
T KOG0300|consen 385 LRN 387 (481)
T ss_pred ecc
Confidence 753
No 142
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=99.64 E-value=1.7e-14 Score=119.01 Aligned_cols=159 Identities=14% Similarity=0.214 Sum_probs=115.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
.|++|...|..+-+++++.|+.++-||+.+|+....+.+|++.|.++.--.....+++|+.||++++||.++++++..+.
T Consensus 116 eINam~ldP~enSi~~AgGD~~~y~~dlE~G~i~r~~rGHtDYvH~vv~R~~~~qilsG~EDGtvRvWd~kt~k~v~~ie 195 (325)
T KOG0649|consen 116 EINAMWLDPSENSILFAGGDGVIYQVDLEDGRIQREYRGHTDYVHSVVGRNANGQILSGAEDGTVRVWDTKTQKHVSMIE 195 (325)
T ss_pred ccceeEeccCCCcEEEecCCeEEEEEEecCCEEEEEEcCCcceeeeeeecccCcceeecCCCccEEEEeccccceeEEec
Confidence 79999999976666666689999999999999999999999999999984444568899999999999999999988872
Q ss_pred C-------------CceeEEEcCCCcEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEe---
Q 040274 149 G-------------HAKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGH--- 212 (359)
Q Consensus 149 ~-------------~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~--- 212 (359)
. .|.+++.+.| .+.|+.+..+.+|+++.. .....++-.. +|..+.|. .+.+++++
T Consensus 196 ~yk~~~~lRp~~g~wigala~~ed-WlvCGgGp~lslwhLrss-e~t~vfpipa-----~v~~v~F~--~d~vl~~G~g~ 266 (325)
T KOG0649|consen 196 PYKNPNLLRPDWGKWIGALAVNED-WLVCGGGPKLSLWHLRSS-ESTCVFPIPA-----RVHLVDFV--DDCVLIGGEGN 266 (325)
T ss_pred cccChhhcCcccCceeEEEeccCc-eEEecCCCceeEEeccCC-CceEEEeccc-----ceeEeeee--cceEEEecccc
Confidence 1 1344443333 677777889999997655 4444443331 57778884 44566665
Q ss_pred ------CCCeEEEEEcCCCCC-ceeeeccCC
Q 040274 213 ------SMGWSGILVPRSSEP-NFDSWVANP 236 (359)
Q Consensus 213 ------~dg~~~i~~~gs~~~-~~~~~~~~~ 236 (359)
.+|.+...++++... ....|...|
T Consensus 267 ~v~~~~l~Gvl~a~ip~~s~~c~s~s~~~~p 297 (325)
T KOG0649|consen 267 HVQSYTLNGVLQANIPVESTACYSASWQTSP 297 (325)
T ss_pred ceeeeeeccEEEEeccCCccceeeecccCCc
Confidence 345566666655443 334555433
No 143
>KOG1273 consensus WD40 repeat protein [General function prediction only]
Probab=99.64 E-value=1.6e-14 Score=123.20 Aligned_cols=181 Identities=14% Similarity=0.117 Sum_probs=130.8
Q ss_pred ceEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeec
Q 040274 51 HILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLY 107 (359)
Q Consensus 51 ~~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~ 107 (359)
..|+.|++.|.+||.|.. +|+|++||++|..|+|+|.|..|.+||+..|.++..+.-
T Consensus 26 a~~~~Fs~~G~~lAvGc~nG~vvI~D~~T~~iar~lsaH~~pi~sl~WS~dgr~LltsS~D~si~lwDl~~gs~l~rirf 105 (405)
T KOG1273|consen 26 AECCQFSRWGDYLAVGCANGRVVIYDFDTFRIARMLSAHVRPITSLCWSRDGRKLLTSSRDWSIKLWDLLKGSPLKRIRF 105 (405)
T ss_pred cceEEeccCcceeeeeccCCcEEEEEccccchhhhhhccccceeEEEecCCCCEeeeecCCceeEEEeccCCCceeEEEc
Confidence 389999999999999876 899999999999999999999999999988876655431
Q ss_pred CCCCeEE-----------------------------------------------EEEecCCCEEEEecCCCeEEEEEcCC
Q 040274 108 HQGPVSA-----------------------------------------------LAFHPNGHLMATTGKECKIKIWDLRK 140 (359)
Q Consensus 108 h~~~v~~-----------------------------------------------l~~~p~g~~l~s~~~d~~i~vwd~~~ 140 (359)
.++|+. ..|++.|+++++|...|.+.++|..+
T Consensus 106 -~spv~~~q~hp~k~n~~va~~~~~sp~vi~~s~~~h~~Lp~d~d~dln~sas~~~fdr~g~yIitGtsKGkllv~~a~t 184 (405)
T KOG1273|consen 106 -DSPVWGAQWHPRKRNKCVATIMEESPVVIDFSDPKHSVLPKDDDGDLNSSASHGVFDRRGKYIITGTSKGKLLVYDAET 184 (405)
T ss_pred -cCccceeeeccccCCeEEEEEecCCcEEEEecCCceeeccCCCccccccccccccccCCCCEEEEecCcceEEEEecch
Confidence 112211 22555678999999999999999999
Q ss_pred CeeeEeec----CCceeEEEcCCC--cEEEEcCCcEEEEcCCCC---Cccccccccc---cCCCCcceeEEEEccCCCEE
Q 040274 141 YEVLQTLT----GHAKTLDFSQKG--LLAVGTGSFAQILGDFSG---SHNYSRYMGN---SMVKGYQIGKVSFRPYEDVL 208 (359)
Q Consensus 141 ~~~~~~~~----~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~---~~~~~~~~~~---~~~~~~~v~~~~~sp~~~~l 208 (359)
.+++..+. ..|..+.++..| ++.-+.|+.|+.|++..- +.....-..| ......+-.+++|+.+|.|+
T Consensus 185 ~e~vas~rits~~~IK~I~~s~~g~~liiNtsDRvIR~ye~~di~~~~r~~e~e~~~K~qDvVNk~~Wk~ccfs~dgeYv 264 (405)
T KOG1273|consen 185 LECVASFRITSVQAIKQIIVSRKGRFLIINTSDRVIRTYEISDIDDEGRDGEVEPEHKLQDVVNKLQWKKCCFSGDGEYV 264 (405)
T ss_pred heeeeeeeechheeeeEEEEeccCcEEEEecCCceEEEEehhhhcccCccCCcChhHHHHHHHhhhhhhheeecCCccEE
Confidence 99988882 457889999999 778888999999986421 1111111111 01122245788999999999
Q ss_pred EEEeCC-CeEEEEEcCCCCCceeeec
Q 040274 209 GIGHSM-GWSGILVPRSSEPNFDSWV 233 (359)
Q Consensus 209 ~~g~~d-g~~~i~~~gs~~~~~~~~~ 233 (359)
+.|+.. ..+.||-.+.|. -+++..
T Consensus 265 ~a~s~~aHaLYIWE~~~Gs-LVKILh 289 (405)
T KOG1273|consen 265 CAGSARAHALYIWEKSIGS-LVKILH 289 (405)
T ss_pred EeccccceeEEEEecCCcc-eeeeec
Confidence 887743 345565554442 344443
No 144
>KOG2919 consensus Guanine nucleotide-binding protein [General function prediction only]
Probab=99.64 E-value=8.3e-15 Score=125.36 Aligned_cols=154 Identities=13% Similarity=0.137 Sum_probs=118.8
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeC-CCCc--ceEEee-----cCCCCeEEEEEecC-CCEEEEecCCCeEEEEEcC
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKP-TTSA--LLIKML-----YHQGPVSALAFHPN-GHLMATTGKECKIKIWDLR 139 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~-~~~~--~~~~~~-----~h~~~v~~l~~~p~-g~~l~s~~~d~~i~vwd~~ 139 (359)
...+++|+|||..|++| .+.+|+++|+ +.|. ++.... +..+.+.+++|+|. ...+++++-...+-||.-.
T Consensus 160 aAhsL~Fs~DGeqlfaG-ykrcirvFdt~RpGr~c~vy~t~~~~k~gq~giisc~a~sP~~~~~~a~gsY~q~~giy~~~ 238 (406)
T KOG2919|consen 160 AAHSLQFSPDGEQLFAG-YKRCIRVFDTSRPGRDCPVYTTVTKGKFGQKGIISCFAFSPMDSKTLAVGSYGQRVGIYNDD 238 (406)
T ss_pred hheeEEecCCCCeEeec-ccceEEEeeccCCCCCCcchhhhhcccccccceeeeeeccCCCCcceeeecccceeeeEecC
Confidence 67899999999999887 4679999998 4442 222222 34788999999994 4588999988888888777
Q ss_pred CCeeeEee---cCCceeEEEcCCC--cEEEEc-CCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeC
Q 040274 140 KYEVLQTL---TGHAKTLDFSQKG--LLAVGT-GSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHS 213 (359)
Q Consensus 140 ~~~~~~~~---~~~v~~~~~s~~g--l~~~~~-d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~ 213 (359)
...++..+ .+.|+.++|.++| +++++. +..|.+||++....++-.+..|...... -.-+...|++++|++|+.
T Consensus 239 ~~~pl~llggh~gGvThL~~~edGn~lfsGaRk~dkIl~WDiR~~~~pv~~L~rhv~~TNQ-RI~FDld~~~~~LasG~t 317 (406)
T KOG2919|consen 239 GRRPLQLLGGHGGGVTHLQWCEDGNKLFSGARKDDKILCWDIRYSRDPVYALERHVGDTNQ-RILFDLDPKGEILASGDT 317 (406)
T ss_pred CCCceeeecccCCCeeeEEeccCcCeecccccCCCeEEEEeehhccchhhhhhhhccCccc-eEEEecCCCCceeeccCC
Confidence 77777777 5669999999999 777664 7899999998887777777777541222 223456689999999999
Q ss_pred CCeEEEEEcCC
Q 040274 214 MGWSGILVPRS 224 (359)
Q Consensus 214 dg~~~i~~~gs 224 (359)
+|.|++|..-.
T Consensus 318 dG~V~vwdlk~ 328 (406)
T KOG2919|consen 318 DGSVRVWDLKD 328 (406)
T ss_pred CccEEEEecCC
Confidence 99999997654
No 145
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=99.63 E-value=6e-14 Score=126.09 Aligned_cols=168 Identities=14% Similarity=0.191 Sum_probs=121.6
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCC-eEEEEeCCCCcceEEeec
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGG-TVTMWKPTTSALLIKMLY 107 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg-~v~lwd~~~~~~~~~~~~ 107 (359)
..+.|+|+|+.+++++. .+.+++|+|++.++++++.++ .+.+||..++..+..+..
T Consensus 76 ~~~~~~~~g~~l~~~~~~~~~l~~~d~~~~~~~~~~~~~~~~~~~~~~~dg~~l~~~~~~~~~~~~~d~~~~~~~~~~~~ 155 (300)
T TIGR03866 76 ELFALHPNGKILYIANEDDNLVTVIDIETRKVLAEIPVGVEPEGMAVSPDGKIVVNTSETTNMAHFIDTKTYEIVDNVLV 155 (300)
T ss_pred cEEEECCCCCEEEEEcCCCCeEEEEECCCCeEEeEeeCCCCcceEEECCCCCEEEEEecCCCeEEEEeCCCCeEEEEEEc
Confidence 57789999998765432 367889999999999988765 567789988776655433
Q ss_pred CCCCeEEEEEecCCCEEEE-ecCCCeEEEEEcCCCeeeEeecC----------CceeEEEcCCC-c--EEEEcCCcEEEE
Q 040274 108 HQGPVSALAFHPNGHLMAT-TGKECKIKIWDLRKYEVLQTLTG----------HAKTLDFSQKG-L--LAVGTGSFAQIL 173 (359)
Q Consensus 108 h~~~v~~l~~~p~g~~l~s-~~~d~~i~vwd~~~~~~~~~~~~----------~v~~~~~s~~g-l--~~~~~d~~i~v~ 173 (359)
.....+++|+|+|.+|+. +..++.|++||+.+++.+..+.. ....++|+|+| + ++.+.++.+.+|
T Consensus 156 -~~~~~~~~~s~dg~~l~~~~~~~~~v~i~d~~~~~~~~~~~~~~~~~~~~~~~~~~i~~s~dg~~~~~~~~~~~~i~v~ 234 (300)
T TIGR03866 156 -DQRPRFAEFTADGKELWVSSEIGGTVSVIDVATRKVIKKITFEIPGVHPEAVQPVGIKLTKDGKTAFVALGPANRVAVV 234 (300)
T ss_pred -CCCccEEEECCCCCEEEEEcCCCCEEEEEEcCcceeeeeeeecccccccccCCccceEECCCCCEEEEEcCCCCeEEEE
Confidence 334578999999998754 45699999999999887665521 13568899999 3 334456789999
Q ss_pred cCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEe-CCCeEEEEEcCCCC
Q 040274 174 GDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGH-SMGWSGILVPRSSE 226 (359)
Q Consensus 174 d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~-~dg~~~i~~~gs~~ 226 (359)
|+... ....... + +..+.+++|+|+|.+|+++. .+|.+.+|...++.
T Consensus 235 d~~~~-~~~~~~~-~----~~~~~~~~~~~~g~~l~~~~~~~~~i~v~d~~~~~ 282 (300)
T TIGR03866 235 DAKTY-EVLDYLL-V----GQRVWQLAFTPDEKYLLTTNGVSNDVSVIDVAALK 282 (300)
T ss_pred ECCCC-cEEEEEE-e----CCCcceEEECCCCCEEEEEcCCCCeEEEEECCCCc
Confidence 97543 3332221 2 12688999999999998764 57877777766543
No 146
>KOG1034 consensus Transcriptional repressor EED/ESC/FIE, required for transcriptional silencing, WD repeat superfamily [Transcription]
Probab=99.63 E-value=2.4e-14 Score=122.80 Aligned_cols=152 Identities=16% Similarity=0.183 Sum_probs=114.9
Q ss_pred ceeEEEEcCC-CCEEEEEeCCCeEEEEeCCCCcceEEee---cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCe--
Q 040274 69 RTDLMRVNPF-NGVVSLGHSGGTVTMWKPTTSALLIKML---YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYE-- 142 (359)
Q Consensus 69 ~v~~l~~sp~-~~~l~tg~~dg~v~lwd~~~~~~~~~~~---~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~-- 142 (359)
.|+.+.++|+ .++++++|.|.+|++|++.+..++..|- +|.+.|.++.|+++|.+++++|.|.+|++|++...+
T Consensus 137 sINeik~~p~~~qlvls~SkD~svRlwnI~~~~Cv~VfGG~egHrdeVLSvD~~~~gd~i~ScGmDhslk~W~l~~~~f~ 216 (385)
T KOG1034|consen 137 SINEIKFHPDRPQLVLSASKDHSVRLWNIQTDVCVAVFGGVEGHRDEVLSVDFSLDGDRIASCGMDHSLKLWRLNVKEFK 216 (385)
T ss_pred cchhhhcCCCCCcEEEEecCCceEEEEeccCCeEEEEecccccccCcEEEEEEcCCCCeeeccCCcceEEEEecChhHHh
Confidence 8999999995 5789999999999999999999988875 799999999999999999999999999999986210
Q ss_pred ----ee-------------------Eee---------------------------------cC-----------------
Q 040274 143 ----VL-------------------QTL---------------------------------TG----------------- 149 (359)
Q Consensus 143 ----~~-------------------~~~---------------------------------~~----------------- 149 (359)
+. ..| +|
T Consensus 217 ~~lE~s~~~~~~~t~~pfpt~~~~fp~fst~diHrnyVDCvrw~gd~ilSkscenaI~~w~pgkl~e~~~~vkp~es~~T 296 (385)
T KOG1034|consen 217 NKLELSITYSPNKTTRPFPTPKTHFPDFSTTDIHRNYVDCVRWFGDFILSKSCENAIVCWKPGKLEESIHNVKPPESATT 296 (385)
T ss_pred hhhhhhcccCCCCccCcCCccccccccccccccccchHHHHHHHhhheeecccCceEEEEecchhhhhhhccCCCcccee
Confidence 00 000 00
Q ss_pred ----------CceeE--EEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 150 ----------HAKTL--DFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 150 ----------~v~~~--~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
.++-+ +|.|-+ ++++...|.|.+||+........+...|.. .+..|...+|+.||.+|+..++|+
T Consensus 297 i~~~~~~~~c~iWfirf~~d~~~~~la~gnq~g~v~vwdL~~~ep~~~ttl~~s~-~~~tVRQ~sfS~dgs~lv~vcdd~ 375 (385)
T KOG1034|consen 297 ILGEFDYPMCDIWFIRFAFDPWQKMLALGNQSGKVYVWDLDNNEPPKCTTLTHSK-SGSTVRQTSFSRDGSILVLVCDDG 375 (385)
T ss_pred eeeEeccCccceEEEEEeecHHHHHHhhccCCCcEEEEECCCCCCccCceEEecc-ccceeeeeeecccCcEEEEEeCCC
Confidence 01112 223333 555667799999998776554444444443 566899999999999999999998
Q ss_pred eEEEEE
Q 040274 216 WSGILV 221 (359)
Q Consensus 216 ~~~i~~ 221 (359)
++.-|.
T Consensus 376 ~Vwrwd 381 (385)
T KOG1034|consen 376 TVWRWD 381 (385)
T ss_pred cEEEEE
Confidence 665443
No 147
>KOG2096 consensus WD40 repeat protein [General function prediction only]
Probab=99.63 E-value=9.2e-15 Score=124.86 Aligned_cols=166 Identities=14% Similarity=0.132 Sum_probs=122.9
Q ss_pred eEEEECCCCCEEEEecc---------------------------ceeEEEEcCCCCEE-EEEeCCCeEEEEeCCC---Cc
Q 040274 52 ILWILPSSGRYMAVAGR---------------------------RTDLMRVNPFNGVV-SLGHSGGTVTMWKPTT---SA 100 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~---------------------------~v~~l~~sp~~~~l-~tg~~dg~v~lwd~~~---~~ 100 (359)
.+++||.||++|++++. ..+.+.|+||..-+ +++....++++|-+.. |.
T Consensus 90 t~~~FsSdGK~lat~~~Dr~Ir~w~~~DF~~~eHr~~R~nve~dhpT~V~FapDc~s~vv~~~~g~~l~vyk~~K~~dG~ 169 (420)
T KOG2096|consen 90 TDVAFSSDGKKLATISGDRSIRLWDVRDFENKEHRCIRQNVEYDHPTRVVFAPDCKSVVVSVKRGNKLCVYKLVKKTDGS 169 (420)
T ss_pred eeeEEcCCCceeEEEeCCceEEEEecchhhhhhhhHhhccccCCCceEEEECCCcceEEEEEccCCEEEEEEeeecccCC
Confidence 88999999999988776 56788888877644 4444555788886532 11
Q ss_pred ceEE--------e-ecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec---CCceeEEEcCCC--cEEEEc
Q 040274 101 LLIK--------M-LYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT---GHAKTLDFSQKG--LLAVGT 166 (359)
Q Consensus 101 ~~~~--------~-~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~---~~v~~~~~s~~g--l~~~~~ 166 (359)
.... | .-|.-.+..+....++.++++++.|..|.+||+. |+.+.++. ...+..+.||+| +++++.
T Consensus 170 ~~~~~v~~D~~~f~~kh~v~~i~iGiA~~~k~imsas~dt~i~lw~lk-Gq~L~~idtnq~~n~~aavSP~GRFia~~gF 248 (420)
T KOG2096|consen 170 GSHHFVHIDNLEFERKHQVDIINIGIAGNAKYIMSASLDTKICLWDLK-GQLLQSIDTNQSSNYDAAVSPDGRFIAVSGF 248 (420)
T ss_pred CCcccccccccccchhcccceEEEeecCCceEEEEecCCCcEEEEecC-CceeeeeccccccccceeeCCCCcEEEEecC
Confidence 1100 1 1355567777777788999999999999999999 88888883 345788999999 566677
Q ss_pred CCcEEEEcCCCCC-------ccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEc
Q 040274 167 GSFAQILGDFSGS-------HNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVP 222 (359)
Q Consensus 167 d~~i~v~d~~~~~-------~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~ 222 (359)
...|.||.+..+. .....+.+|. +.|..++|+|+...+++.+.||..+||.+
T Consensus 249 TpDVkVwE~~f~kdG~fqev~rvf~LkGH~----saV~~~aFsn~S~r~vtvSkDG~wriwdt 307 (420)
T KOG2096|consen 249 TPDVKVWEPIFTKDGTFQEVKRVFSLKGHQ----SAVLAAAFSNSSTRAVTVSKDGKWRIWDT 307 (420)
T ss_pred CCCceEEEEEeccCcchhhhhhhheeccch----hheeeeeeCCCcceeEEEecCCcEEEeec
Confidence 8899999865431 1122344554 48999999999999999999998888865
No 148
>KOG1007 consensus WD repeat protein TSSC1, WD repeat superfamily [Function unknown]
Probab=99.62 E-value=1.3e-14 Score=122.46 Aligned_cols=162 Identities=20% Similarity=0.209 Sum_probs=126.3
Q ss_pred eEEEECCCCCEEEEecc----------------------------ceeEEEEcC--CCCEEEEEeCCCeEEEEeCCCCcc
Q 040274 52 ILWILPSSGRYMAVAGR----------------------------RTDLMRVNP--FNGVVSLGHSGGTVTMWKPTTSAL 101 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~----------------------------~v~~l~~sp--~~~~l~tg~~dg~v~lwd~~~~~~ 101 (359)
.|+.|.||+..|++-.+ ..++-+||| +++.+++. .|+++..||++|...
T Consensus 127 ~cvew~Pns~klasm~dn~i~l~~l~ess~~vaev~ss~s~e~~~~ftsg~WspHHdgnqv~tt-~d~tl~~~D~RT~~~ 205 (370)
T KOG1007|consen 127 NCVEWEPNSDKLASMDDNNIVLWSLDESSKIVAEVLSSESAEMRHSFTSGAWSPHHDGNQVATT-SDSTLQFWDLRTMKK 205 (370)
T ss_pred eeEEEcCCCCeeEEeccCceEEEEcccCcchheeecccccccccceecccccCCCCccceEEEe-CCCcEEEEEccchhh
Confidence 89999999999887665 567788999 56666665 589999999999877
Q ss_pred eEEee-cCCCCeEEEEEecCCC-EEEEecCCCeEEEEEcCCC-eeeEeecCC---ceeEEEcCCC---cEEEEcCCcEEE
Q 040274 102 LIKML-YHQGPVSALAFHPNGH-LMATTGKECKIKIWDLRKY-EVLQTLTGH---AKTLDFSQKG---LLAVGTGSFAQI 172 (359)
Q Consensus 102 ~~~~~-~h~~~v~~l~~~p~g~-~l~s~~~d~~i~vwd~~~~-~~~~~~~~~---v~~~~~s~~g---l~~~~~d~~i~v 172 (359)
...+. +|...|..+.|+|+-. +|+||+.||.|++||.|.- .++.++.+| |+++.|+|.. ++++|.|..|.+
T Consensus 206 ~~sI~dAHgq~vrdlDfNpnkq~~lvt~gDdgyvriWD~R~tk~pv~el~~HsHWvW~VRfn~~hdqLiLs~~SDs~V~L 285 (370)
T KOG1007|consen 206 NNSIEDAHGQRVRDLDFNPNKQHILVTCGDDGYVRIWDTRKTKFPVQELPGHSHWVWAVRFNPEHDQLILSGGSDSAVNL 285 (370)
T ss_pred hcchhhhhcceeeeccCCCCceEEEEEcCCCccEEEEeccCCCccccccCCCceEEEEEEecCccceEEEecCCCceeEE
Confidence 77665 7889999999999765 5899999999999999974 578888654 7999999976 888999999998
Q ss_pred EcCCCCC----------------------------ccccccccccCCCCcceeEEEEccCCCE-EEEEeCCCeEE
Q 040274 173 LGDFSGS----------------------------HNYSRYMGNSMVKGYQIGKVSFRPYEDV-LGIGHSMGWSG 218 (359)
Q Consensus 173 ~d~~~~~----------------------------~~~~~~~~~~~~~~~~v~~~~~sp~~~~-l~~g~~dg~~~ 218 (359)
|....-. ..+..|..|. ..|++++||.-..+ +|+-+.||.+.
T Consensus 286 sca~svSSE~qi~~~~dese~e~~dseer~kpL~dg~l~tydehE----DSVY~~aWSsadPWiFASLSYDGRvi 356 (370)
T KOG1007|consen 286 SCASSVSSEQQIEFEDDESESEDEDSEERVKPLQDGQLETYDEHE----DSVYALAWSSADPWIFASLSYDGRVI 356 (370)
T ss_pred EeccccccccccccccccccCcchhhHHhcccccccccccccccc----cceEEEeeccCCCeeEEEeccCceEE
Confidence 8642210 1122344443 48999999997766 56778888543
No 149
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=99.62 E-value=4e-14 Score=131.67 Aligned_cols=165 Identities=13% Similarity=0.158 Sum_probs=133.4
Q ss_pred eEEEECCCCCEEEEecc----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceE--Eeec
Q 040274 52 ILWILPSSGRYMAVAGR----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLI--KMLY 107 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~--~~~~ 107 (359)
-+|+|++.|+++-++.. .|++|+.+|.+..++.|+.||.+..++...+.... .|.-
T Consensus 73 E~L~W~e~~RLFS~g~sg~i~EwDl~~lk~~~~~d~~gg~IWsiai~p~~~~l~IgcddGvl~~~s~~p~~I~~~r~l~r 152 (691)
T KOG2048|consen 73 ESLAWAEGGRLFSSGLSGSITEWDLHTLKQKYNIDSNGGAIWSIAINPENTILAIGCDDGVLYDFSIGPDKITYKRSLMR 152 (691)
T ss_pred eeEEEccCCeEEeecCCceEEEEecccCceeEEecCCCcceeEEEeCCccceEEeecCCceEEEEecCCceEEEEeeccc
Confidence 67889888887766655 89999999999999999999988888877765443 3445
Q ss_pred CCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee--------c-C--CceeEEEcCCC-cEEEEcCCcEEEEcC
Q 040274 108 HQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL--------T-G--HAKTLDFSQKG-LLAVGTGSFAQILGD 175 (359)
Q Consensus 108 h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~--------~-~--~v~~~~~s~~g-l~~~~~d~~i~v~d~ 175 (359)
.++.|.+++|+|++..+++|+.||.|++||..++..++.. . . -|+++.|-.++ +++|.+.|+|.+||.
T Consensus 153 q~sRvLslsw~~~~~~i~~Gs~Dg~Iriwd~~~~~t~~~~~~~~d~l~k~~~~iVWSv~~Lrd~tI~sgDS~G~V~FWd~ 232 (691)
T KOG2048|consen 153 QKSRVLSLSWNPTGTKIAGGSIDGVIRIWDVKSGQTLHIITMQLDRLSKREPTIVWSVLFLRDSTIASGDSAGTVTFWDS 232 (691)
T ss_pred ccceEEEEEecCCccEEEecccCceEEEEEcCCCceEEEeeecccccccCCceEEEEEEEeecCcEEEecCCceEEEEcc
Confidence 6789999999999999999999999999999998876632 1 1 15778887888 888888899999995
Q ss_pred CCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 176 FSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 176 ~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
..+ .....+..|.. .|.+++..++++.+.+++.|+.+.-|-
T Consensus 233 ~~g-TLiqS~~~h~a----dVl~Lav~~~~d~vfsaGvd~~ii~~~ 273 (691)
T KOG2048|consen 233 IFG-TLIQSHSCHDA----DVLALAVADNEDRVFSAGVDPKIIQYS 273 (691)
T ss_pred cCc-chhhhhhhhhc----ceeEEEEcCCCCeEEEccCCCceEEEE
Confidence 444 55555555543 899999999999999999999765443
No 150
>KOG0290 consensus Conserved WD40 repeat-containing protein AN11 [Function unknown]
Probab=99.61 E-value=1.6e-14 Score=122.03 Aligned_cols=150 Identities=14% Similarity=0.186 Sum_probs=121.7
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCCcc---eEEeecCCCCeEEEEEecCC-CEEEEecCCCeEEEEEcCCCee
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTSAL---LIKMLYHQGPVSALAFHPNG-HLMATTGKECKIKIWDLRKYEV 143 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~~---~~~~~~h~~~v~~l~~~p~g-~~l~s~~~d~~i~vwd~~~~~~ 143 (359)
++++..|+. +-++|.++|-|-+..|||+.++.. ...+.+|...|+.++|...+ ..||++|.||.|++||+|..+.
T Consensus 152 PlTSFDWne~dp~~igtSSiDTTCTiWdie~~~~~~vkTQLIAHDKEV~DIaf~~~s~~~FASvgaDGSvRmFDLR~leH 231 (364)
T KOG0290|consen 152 PLTSFDWNEVDPNLIGTSSIDTTCTIWDIETGVSGTVKTQLIAHDKEVYDIAFLKGSRDVFASVGADGSVRMFDLRSLEH 231 (364)
T ss_pred cccccccccCCcceeEeecccCeEEEEEEeeccccceeeEEEecCcceeEEEeccCccceEEEecCCCcEEEEEeccccc
Confidence 899999998 788999999999999999998733 45577999999999998854 4689999999999999998765
Q ss_pred eEee---c---CCceeEEEcCCC---cEEEEcC-CcEEEEcCCCCCccccccccccCCCCcceeEEEEccCC-CEEEEEe
Q 040274 144 LQTL---T---GHAKTLDFSQKG---LLAVGTG-SFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYE-DVLGIGH 212 (359)
Q Consensus 144 ~~~~---~---~~v~~~~~s~~g---l~~~~~d-~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~-~~l~~g~ 212 (359)
-..+ + .+...++|++.. +++...| ..|.|.|++.....+..+..|.. .|+.++|.|.. ..|++++
T Consensus 232 STIIYE~p~~~~pLlRLswnkqDpnymATf~~dS~~V~iLDiR~P~tpva~L~~H~a----~VNgIaWaPhS~~hictaG 307 (364)
T KOG0290|consen 232 STIIYEDPSPSTPLLRLSWNKQDPNYMATFAMDSNKVVILDIRVPCTPVARLRNHQA----SVNGIAWAPHSSSHICTAG 307 (364)
T ss_pred ceEEecCCCCCCcceeeccCcCCchHHhhhhcCCceEEEEEecCCCcceehhhcCcc----cccceEecCCCCceeeecC
Confidence 3333 2 246788998877 5555554 68999999888788888888865 89999999975 6788888
Q ss_pred CCCeEEEEEc
Q 040274 213 SMGWSGILVP 222 (359)
Q Consensus 213 ~dg~~~i~~~ 222 (359)
+|....||.-
T Consensus 308 DD~qaliWDl 317 (364)
T KOG0290|consen 308 DDCQALIWDL 317 (364)
T ss_pred CcceEEEEec
Confidence 8877777653
No 151
>KOG4328 consensus WD40 protein [Function unknown]
Probab=99.61 E-value=1.8e-14 Score=128.36 Aligned_cols=171 Identities=11% Similarity=0.084 Sum_probs=131.1
Q ss_pred eEEEECCCCC-EEEEecc----------------------------ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCCcc
Q 040274 52 ILWILPSSGR-YMAVAGR----------------------------RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTSAL 101 (359)
Q Consensus 52 ~~l~~spdg~-~l~~~~~----------------------------~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~~ 101 (359)
++++|+|.-. .++..|+ +|++|.|+| +...|++.|.||+|++-|+.....
T Consensus 190 t~l~fHPt~~~~lva~GdK~G~VG~Wn~~~~~~d~d~v~~f~~hs~~Vs~l~F~P~n~s~i~ssSyDGtiR~~D~~~~i~ 269 (498)
T KOG4328|consen 190 TSLAFHPTENRKLVAVGDKGGQVGLWNFGTQEKDKDGVYLFTPHSGPVSGLKFSPANTSQIYSSSYDGTIRLQDFEGNIS 269 (498)
T ss_pred EEEEecccCcceEEEEccCCCcEEEEecCCCCCccCceEEeccCCccccceEecCCChhheeeeccCceeeeeeecchhh
Confidence 9999999665 5554444 799999999 557899999999999999987643
Q ss_pred --eEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCee-eEee---cCCceeEEEcCCC---cEEEEcCCcEEE
Q 040274 102 --LIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEV-LQTL---TGHAKTLDFSQKG---LLAVGTGSFAQI 172 (359)
Q Consensus 102 --~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~-~~~~---~~~v~~~~~s~~g---l~~~~~d~~i~v 172 (359)
+..+......+.++.|+.+...++.++.=|.+.+||.+++.. ...+ ...|++++++|-. ++++|.|++.+|
T Consensus 270 e~v~s~~~d~~~fs~~d~~~e~~~vl~~~~~G~f~~iD~R~~~s~~~~~~lh~kKI~sv~~NP~~p~~laT~s~D~T~kI 349 (498)
T KOG4328|consen 270 EEVLSLDTDNIWFSSLDFSAESRSVLFGDNVGNFNVIDLRTDGSEYENLRLHKKKITSVALNPVCPWFLATASLDQTAKI 349 (498)
T ss_pred HHHhhcCccceeeeeccccCCCccEEEeecccceEEEEeecCCccchhhhhhhcccceeecCCCCchheeecccCcceee
Confidence 333333455677888888888888888878999999998643 2222 4579999999987 888999999999
Q ss_pred EcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 173 LGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 173 ~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
||++.-.....++.. ...|...|.++.|||.+-.|++.+.|..++||...
T Consensus 350 WD~R~l~~K~sp~ls-t~~HrrsV~sAyFSPs~gtl~TT~~D~~IRv~dss 399 (498)
T KOG4328|consen 350 WDLRQLRGKASPFLS-TLPHRRSVNSAYFSPSGGTLLTTCQDNEIRVFDSS 399 (498)
T ss_pred eehhhhcCCCCccee-cccccceeeeeEEcCCCCceEeeccCCceEEeecc
Confidence 998764333322111 11144489999999998889999999999999874
No 152
>KOG0270 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.61 E-value=1.6e-14 Score=128.25 Aligned_cols=146 Identities=14% Similarity=0.190 Sum_probs=110.3
Q ss_pred ceeEEEEcCC-------CCEEEEEeCCCeEEEEeCCCC---cceEE------------------eecCCCCeEEEEEecC
Q 040274 69 RTDLMRVNPF-------NGVVSLGHSGGTVTMWKPTTS---ALLIK------------------MLYHQGPVSALAFHPN 120 (359)
Q Consensus 69 ~v~~l~~sp~-------~~~l~tg~~dg~v~lwd~~~~---~~~~~------------------~~~h~~~v~~l~~~p~ 120 (359)
...|+.|... |+++|.|+.|..|.|||+.-. .|... ..+|+..|.+++|+..
T Consensus 175 fPLC~ewld~~~~~~~~gNyvAiGtmdp~IeIWDLDI~d~v~P~~~LGs~~sk~~~k~~k~~~~~~gHTdavl~Ls~n~~ 254 (463)
T KOG0270|consen 175 FPLCIEWLDHGSKSGGAGNYVAIGTMDPEIEIWDLDIVDAVLPCVTLGSKASKKKKKKGKRSNSASGHTDAVLALSWNRN 254 (463)
T ss_pred cchhhhhhhcCCCCCCCcceEEEeccCceeEEeccccccccccceeechhhhhhhhhhcccccccccchHHHHHHHhccc
Confidence 3467777432 569999999999999997522 11111 2268889999999875
Q ss_pred -CCEEEEecCCCeEEEEEcCCCeeeEee---cCCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCC
Q 040274 121 -GHLMATTGKECKIKIWDLRKYEVLQTL---TGHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKG 193 (359)
Q Consensus 121 -g~~l~s~~~d~~i~vwd~~~~~~~~~~---~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~ 193 (359)
.+.||+||.|.+|++||+.++++..++ .+.|.++.|+|.. +++|+.|++|.++|.+.......... . .
T Consensus 255 ~~nVLaSgsaD~TV~lWD~~~g~p~~s~~~~~k~Vq~l~wh~~~p~~LLsGs~D~~V~l~D~R~~~~s~~~wk-~----~ 329 (463)
T KOG0270|consen 255 FRNVLASGSADKTVKLWDVDTGKPKSSITHHGKKVQTLEWHPYEPSVLLSGSYDGTVALKDCRDPSNSGKEWK-F----D 329 (463)
T ss_pred cceeEEecCCCceEEEEEcCCCCcceehhhcCCceeEEEecCCCceEEEeccccceEEeeeccCccccCceEE-e----c
Confidence 456999999999999999999998887 4679999999986 89999999999999775322222222 2 2
Q ss_pred cceeEEEEccCC-CEEEEEeCCCeEEE
Q 040274 194 YQIGKVSFRPYE-DVLGIGHSMGWSGI 219 (359)
Q Consensus 194 ~~v~~~~~sp~~-~~l~~g~~dg~~~i 219 (359)
+.|..+.|.|.. ..++++..||+++-
T Consensus 330 g~VEkv~w~~~se~~f~~~tddG~v~~ 356 (463)
T KOG0270|consen 330 GEVEKVAWDPHSENSFFVSTDDGTVYY 356 (463)
T ss_pred cceEEEEecCCCceeEEEecCCceEEe
Confidence 269999999976 45677778888654
No 153
>KOG4378 consensus Nuclear protein COP1 [Signal transduction mechanisms]
Probab=99.61 E-value=2.5e-14 Score=128.61 Aligned_cols=166 Identities=17% Similarity=0.249 Sum_probs=134.6
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecC
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYH 108 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h 108 (359)
+|++......|+++||. .|+++.++....+|++++..|.|.|..+.++.....|...
T Consensus 83 ~Cv~~~s~S~y~~sgG~~~~Vkiwdl~~kl~hr~lkdh~stvt~v~YN~~DeyiAsvs~gGdiiih~~~t~~~tt~f~~~ 162 (673)
T KOG4378|consen 83 FCVACASQSLYEISGGQSGCVKIWDLRAKLIHRFLKDHQSTVTYVDYNNTDEYIASVSDGGDIIIHGTKTKQKTTTFTID 162 (673)
T ss_pred HHHhhhhcceeeeccCcCceeeehhhHHHHHhhhccCCcceeEEEEecCCcceeEEeccCCcEEEEecccCccccceecC
Confidence 67776667788888876 8999999999999999999999999999998877777644
Q ss_pred CC-CeEEEEEecCCCE-EEEecCCCeEEEEEcCCCeeeEee----cCCceeEEEcCCC---cEEEEcCCcEEEEcCCCCC
Q 040274 109 QG-PVSALAFHPNGHL-MATTGKECKIKIWDLRKYEVLQTL----TGHAKTLDFSQKG---LLAVGTGSFAQILGDFSGS 179 (359)
Q Consensus 109 ~~-~v~~l~~~p~g~~-l~s~~~d~~i~vwd~~~~~~~~~~----~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~ 179 (359)
.+ .|.-+.|+|..+. |.+++.+|.|.+||+....+++.+ ..+...|||+|.. ++++|.|..|.+||....
T Consensus 163 sgqsvRll~ys~skr~lL~~asd~G~VtlwDv~g~sp~~~~~~~HsAP~~gicfspsne~l~vsVG~Dkki~~yD~~s~- 241 (673)
T KOG4378|consen 163 SGQSVRLLRYSPSKRFLLSIASDKGAVTLWDVQGMSPIFHASEAHSAPCRGICFSPSNEALLVSVGYDKKINIYDIRSQ- 241 (673)
T ss_pred CCCeEEEeecccccceeeEeeccCCeEEEEeccCCCcccchhhhccCCcCcceecCCccceEEEecccceEEEeecccc-
Confidence 34 4568999997664 677899999999999987777776 4567899999988 788999999999996543
Q ss_pred cccccc-ccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCC
Q 040274 180 HNYSRY-MGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRS 224 (359)
Q Consensus 180 ~~~~~~-~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs 224 (359)
.....+ ..| +.+.++|+++|.+|+.|+..|.+..|..-+
T Consensus 242 ~s~~~l~y~~------Plstvaf~~~G~~L~aG~s~G~~i~YD~R~ 281 (673)
T KOG4378|consen 242 ASTDRLTYSH------PLSTVAFSECGTYLCAGNSKGELIAYDMRS 281 (673)
T ss_pred cccceeeecC------CcceeeecCCceEEEeecCCceEEEEeccc
Confidence 233222 233 789999999999999999999877764433
No 154
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=99.60 E-value=3.8e-14 Score=120.59 Aligned_cols=170 Identities=15% Similarity=0.206 Sum_probs=124.0
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCee--eEe
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEV--LQT 146 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~--~~~ 146 (359)
.|++|.|+|.++.|++++.||++++||.........+ .|..++.+++|.+ ...+++|+.||.|+++|+.++.. +.+
T Consensus 15 ~IS~v~f~~~~~~LLvssWDgslrlYdv~~~~l~~~~-~~~~plL~c~F~d-~~~~~~G~~dg~vr~~Dln~~~~~~igt 92 (323)
T KOG1036|consen 15 GISSVKFSPSSSDLLVSSWDGSLRLYDVPANSLKLKF-KHGAPLLDCAFAD-ESTIVTGGLDGQVRRYDLNTGNEDQIGT 92 (323)
T ss_pred ceeeEEEcCcCCcEEEEeccCcEEEEeccchhhhhhe-ecCCceeeeeccC-CceEEEeccCceEEEEEecCCcceeecc
Confidence 5899999999889999999999999999987554444 6899999999987 46799999999999999998764 444
Q ss_pred ecCCceeEEEcCC-C-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCC
Q 040274 147 LTGHAKTLDFSQK-G-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRS 224 (359)
Q Consensus 147 ~~~~v~~~~~s~~-g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs 224 (359)
....+.|+.+++- | ++++|+|++|.+||.+.. .....+... ..|.++.. .|+.|++|+.+..+.
T Consensus 93 h~~~i~ci~~~~~~~~vIsgsWD~~ik~wD~R~~-~~~~~~d~~-----kkVy~~~v--~g~~LvVg~~~r~v~------ 158 (323)
T KOG1036|consen 93 HDEGIRCIEYSYEVGCVISGSWDKTIKFWDPRNK-VVVGTFDQG-----KKVYCMDV--SGNRLVVGTSDRKVL------ 158 (323)
T ss_pred CCCceEEEEeeccCCeEEEcccCccEEEEecccc-ccccccccC-----ceEEEEec--cCCEEEEeecCceEE------
Confidence 4678999999964 3 999999999999997652 222222222 26877765 566777777666444
Q ss_pred CCCceeeeccCCCCChhhhhhHHHHHhhhccCCCeeeeCCC
Q 040274 225 SEPNFDSWVANPFETSKQRREKEVHSLLDKLLLETIMLNPS 265 (359)
Q Consensus 225 ~~~~~~~~~~~~~~~~~~~~e~ev~~ll~~~~~~~i~~~~~ 265 (359)
+|+........|+++..+ +++..-|.+-|+
T Consensus 159 ------iyDLRn~~~~~q~reS~l-----kyqtR~v~~~pn 188 (323)
T KOG1036|consen 159 ------IYDLRNLDEPFQRRESSL-----KYQTRCVALVPN 188 (323)
T ss_pred ------EEEcccccchhhhccccc-----eeEEEEEEEecC
Confidence 444443333334554432 245555666664
No 155
>KOG2106 consensus Uncharacterized conserved protein, contains HELP and WD40 domains [Function unknown]
Probab=99.60 E-value=1.8e-13 Score=123.41 Aligned_cols=169 Identities=20% Similarity=0.299 Sum_probs=123.8
Q ss_pred eEEEECC-CCCEEEEecc--------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEE
Q 040274 52 ILWILPS-SGRYMAVAGR--------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIK 104 (359)
Q Consensus 52 ~~l~~sp-dg~~l~~~~~--------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~ 104 (359)
+...|+| |.+.++++|. .|.|++|.++|. ++||.++|.|.||+..+......
T Consensus 204 ~~a~FHPtd~nliit~Gk~H~~Fw~~~~~~l~k~~~~fek~ekk~Vl~v~F~engd-viTgDS~G~i~Iw~~~~~~~~k~ 282 (626)
T KOG2106|consen 204 FLATFHPTDPNLIITCGKGHLYFWTLRGGSLVKRQGIFEKREKKFVLCVTFLENGD-VITGDSGGNILIWSKGTNRISKQ 282 (626)
T ss_pred EEEEeccCCCcEEEEeCCceEEEEEccCCceEEEeeccccccceEEEEEEEcCCCC-EEeecCCceEEEEeCCCceEEeE
Confidence 7888999 4556667776 799999999885 56999999999999988777777
Q ss_pred eecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCee------------eEee-----------------c-------
Q 040274 105 MLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEV------------LQTL-----------------T------- 148 (359)
Q Consensus 105 ~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~------------~~~~-----------------~------- 148 (359)
...|.+.|.+++.-.+|.+| +|+.|..|..||-. .+. ++++ .
T Consensus 283 ~~aH~ggv~~L~~lr~Gtll-SGgKDRki~~Wd~~-y~k~r~~elPe~~G~iRtv~e~~~di~vGTtrN~iL~Gt~~~~f 360 (626)
T KOG2106|consen 283 VHAHDGGVFSLCMLRDGTLL-SGGKDRKIILWDDN-YRKLRETELPEQFGPIRTVAEGKGDILVGTTRNFILQGTLENGF 360 (626)
T ss_pred eeecCCceEEEEEecCccEe-ecCccceEEecccc-ccccccccCchhcCCeeEEecCCCcEEEeeccceEEEeeecCCc
Confidence 67999999999999999655 59999999999831 111 1111 0
Q ss_pred --------CCceeEEEcCCC--cEEEEcCCcEEEEcCCCCC----------------------------------ccccc
Q 040274 149 --------GHAKTLDFSQKG--LLAVGTGSFAQILGDFSGS----------------------------------HNYSR 184 (359)
Q Consensus 149 --------~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~----------------------------------~~~~~ 184 (359)
...+.++.+|+. +++++.|+.+++|+-.... +....
T Consensus 361 ~~~v~gh~delwgla~hps~~q~~T~gqdk~v~lW~~~k~~wt~~~~d~~~~~~fhpsg~va~Gt~~G~w~V~d~e~~~l 440 (626)
T KOG2106|consen 361 TLTVQGHGDELWGLATHPSKNQLLTCGQDKHVRLWNDHKLEWTKIIEDPAECADFHPSGVVAVGTATGRWFVLDTETQDL 440 (626)
T ss_pred eEEEEecccceeeEEcCCChhheeeccCcceEEEccCCceeEEEEecCceeEeeccCcceEEEeeccceEEEEeccccee
Confidence 113566777776 8888889999998822110 00111
Q ss_pred cccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCC
Q 040274 185 YMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSS 225 (359)
Q Consensus 185 ~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~ 225 (359)
+..|. .+.++++++|+|+|.+||+|+.|+.+.||....+
T Consensus 441 v~~~~--d~~~ls~v~ysp~G~~lAvgs~d~~iyiy~Vs~~ 479 (626)
T KOG2106|consen 441 VTIHT--DNEQLSVVRYSPDGAFLAVGSHDNHIYIYRVSAN 479 (626)
T ss_pred EEEEe--cCCceEEEEEcCCCCEEEEecCCCeEEEEEECCC
Confidence 22222 2457999999999999999999999998754443
No 156
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=99.60 E-value=1.2e-13 Score=128.51 Aligned_cols=170 Identities=13% Similarity=0.114 Sum_probs=134.3
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML 106 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~ 106 (359)
.+|+++.+.+.||.+-. .|.+++|++ +..|++.+.+|+|.-||+.++++...+.
T Consensus 29 ~slA~s~kS~~lAvsRt~g~IEiwN~~~~w~~~~vi~g~~drsIE~L~W~e-~~RLFS~g~sg~i~EwDl~~lk~~~~~d 107 (691)
T KOG2048|consen 29 VSLAYSHKSNQLAVSRTDGNIEIWNLSNNWFLEPVIHGPEDRSIESLAWAE-GGRLFSSGLSGSITEWDLHTLKQKYNID 107 (691)
T ss_pred EEEEEeccCCceeeeccCCcEEEEccCCCceeeEEEecCCCCceeeEEEcc-CCeEEeecCCceEEEEecccCceeEEec
Confidence 78889888888777543 899999995 5577788899999999999999999999
Q ss_pred cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee-----cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCC
Q 040274 107 YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL-----TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGS 179 (359)
Q Consensus 107 ~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~-----~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~ 179 (359)
...+.|++++.+|.+..++.|+.||.++.+++..+...+.. .+.+.+++|+|++ +++|+.||.|++||...+.
T Consensus 108 ~~gg~IWsiai~p~~~~l~IgcddGvl~~~s~~p~~I~~~r~l~rq~sRvLslsw~~~~~~i~~Gs~Dg~Iriwd~~~~~ 187 (691)
T KOG2048|consen 108 SNGGAIWSIAINPENTILAIGCDDGVLYDFSIGPDKITYKRSLMRQKSRVLSLSWNPTGTKIAGGSIDGVIRIWDVKSGQ 187 (691)
T ss_pred CCCcceeEEEeCCccceEEeecCCceEEEEecCCceEEEEeecccccceEEEEEecCCccEEEecccCceEEEEEcCCCc
Confidence 99999999999999999999999998888888777654433 4779999999999 7888899999999976553
Q ss_pred ccccc---cccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 180 HNYSR---YMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 180 ~~~~~---~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
..... +..-......-|+++.|-.+ ..|++|.+.|++.+|.+.
T Consensus 188 t~~~~~~~~d~l~k~~~~iVWSv~~Lrd-~tI~sgDS~G~V~FWd~~ 233 (691)
T KOG2048|consen 188 TLHIITMQLDRLSKREPTIVWSVLFLRD-STIASGDSAGTVTFWDSI 233 (691)
T ss_pred eEEEeeecccccccCCceEEEEEEEeec-CcEEEecCCceEEEEccc
Confidence 33211 11111002235788888855 468999999999997553
No 157
>KOG1188 consensus WD40 repeat protein [General function prediction only]
Probab=99.60 E-value=1.6e-14 Score=124.49 Aligned_cols=138 Identities=18% Similarity=0.295 Sum_probs=108.0
Q ss_pred CEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEec--CCCEEEEecCCCeEEEEEcCCCeeeEee--cC----Cc
Q 040274 80 GVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHP--NGHLMATTGKECKIKIWDLRKYEVLQTL--TG----HA 151 (359)
Q Consensus 80 ~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p--~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~~----~v 151 (359)
..++++..+|+|++||..+++.+..|.+|...++.+.|.. .+..+.+|+.||+|++||+|+......+ .. +-
T Consensus 41 ~~vav~lSngsv~lyd~~tg~~l~~fk~~~~~~N~vrf~~~ds~h~v~s~ssDG~Vr~wD~Rs~~e~a~~~~~~~~~~~f 120 (376)
T KOG1188|consen 41 TAVAVSLSNGSVRLYDKGTGQLLEEFKGPPATTNGVRFISCDSPHGVISCSSDGTVRLWDIRSQAESARISWTQQSGTPF 120 (376)
T ss_pred eeEEEEecCCeEEEEeccchhhhheecCCCCcccceEEecCCCCCeeEEeccCCeEEEEEeecchhhhheeccCCCCCcc
Confidence 4688899999999999999999999999999999999976 5778999999999999999986543333 21 23
Q ss_pred eeEEEcCCC-cEEEEc-----CCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCC-CEEEEEeCCCeEEEE
Q 040274 152 KTLDFSQKG-LLAVGT-----GSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYE-DVLGIGHSMGWSGIL 220 (359)
Q Consensus 152 ~~~~~s~~g-l~~~~~-----d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~-~~l~~g~~dg~~~i~ 220 (359)
.+++..-.+ +++++. +-.|.+||++.....+..+... |...|++++|+|.. +.|++|+.||.+.+|
T Consensus 121 ~~ld~nck~~ii~~GtE~~~s~A~v~lwDvR~~qq~l~~~~eS---H~DDVT~lrFHP~~pnlLlSGSvDGLvnlf 193 (376)
T KOG1188|consen 121 ICLDLNCKKNIIACGTELTRSDASVVLWDVRSEQQLLRQLNES---HNDDVTQLRFHPSDPNLLLSGSVDGLVNLF 193 (376)
T ss_pred eEeeccCcCCeEEeccccccCceEEEEEEeccccchhhhhhhh---ccCcceeEEecCCCCCeEEeecccceEEee
Confidence 555555344 666664 4689999988776545444332 34489999999954 899999999998884
No 158
>KOG1063 consensus RNA polymerase II elongator complex, subunit ELP2, WD repeat superfamily [Chromatin structure and dynamics; Transcription]
Probab=99.60 E-value=3e-14 Score=132.76 Aligned_cols=169 Identities=12% Similarity=0.194 Sum_probs=125.2
Q ss_pred eEEEECCCCCEEEEecc----------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCc-c-
Q 040274 52 ILWILPSSGRYMAVAGR----------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSA-L- 101 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~----------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~-~- 101 (359)
|+++.+|+|+++|++.. .|+.|+||||+++|++.+.|.++.+|...... .
T Consensus 529 ~~l~~s~~gnliASaCKS~~~ehAvI~lw~t~~W~~~~~L~~HsLTVT~l~FSpdg~~LLsvsRDRt~sl~~~~~~~~~e 608 (764)
T KOG1063|consen 529 YALAISPTGNLIASACKSSLKEHAVIRLWNTANWLQVQELEGHSLTVTRLAFSPDGRYLLSVSRDRTVSLYEVQEDIKDE 608 (764)
T ss_pred EEEEecCCCCEEeehhhhCCccceEEEEEeccchhhhheecccceEEEEEEECCCCcEEEEeecCceEEeeeeecccchh
Confidence 99999999999999887 89999999999999999999999999875331 1
Q ss_pred --eEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCC--eeeEee-----cCCceeEEEcCCC------cEEEE-
Q 040274 102 --LIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKY--EVLQTL-----TGHAKTLDFSQKG------LLAVG- 165 (359)
Q Consensus 102 --~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~--~~~~~~-----~~~v~~~~~s~~g------l~~~~- 165 (359)
......|+..|++++|+|++.+|+|+|.|.+|++|..... +.+..+ ...|+.++|.|-. ++++|
T Consensus 609 ~~fa~~k~HtRIIWdcsW~pde~~FaTaSRDK~VkVW~~~~~~d~~i~~~a~~~~~~aVTAv~~~~~~~~e~~~~vavGl 688 (764)
T KOG1063|consen 609 FRFACLKAHTRIIWDCSWSPDEKYFATASRDKKVKVWEEPDLRDKYISRFACLKFSLAVTAVAYLPVDHNEKGDVVAVGL 688 (764)
T ss_pred hhhccccccceEEEEcccCcccceeEEecCCceEEEEeccCchhhhhhhhchhccCCceeeEEeeccccccccceEEEEe
Confidence 1235689999999999999999999999999999988776 443332 5678888887732 55655
Q ss_pred cCCcEEEEcCCCCCcc-------ccccccccCCCCcceeEEEEccCC----------CEEEEEeCCCeEEEE
Q 040274 166 TGSFAQILGDFSGSHN-------YSRYMGNSMVKGYQIGKVSFRPYE----------DVLGIGHSMGWSGIL 220 (359)
Q Consensus 166 ~d~~i~v~d~~~~~~~-------~~~~~~~~~~~~~~v~~~~~sp~~----------~~l~~g~~dg~~~i~ 220 (359)
..|.|.+|........ ........+.+...|..+.|.|.. ..|++|+.|..++|+
T Consensus 689 e~GeI~l~~~~~~~~~~~~~~~~~~~~l~~~~~~~~aV~rl~w~p~~~~~~~~~~~~l~la~~g~D~~vri~ 760 (764)
T KOG1063|consen 689 EKGEIVLWRRKREHRQVTVGTFNLDTRLCATIGPDSAVNRLLWRPTCSDDWVEDKEWLNLAVGGDDESVRIF 760 (764)
T ss_pred cccEEEEEecccccccccceeeeeccccccccChHHhhheeEeccccccccccccceeEEeeecccceeEEe
Confidence 4699999984311111 111111112255579999999862 234677766666554
No 159
>KOG0771 consensus Prolactin regulatory element-binding protein/Protein transport protein SEC12p [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.60 E-value=9.7e-15 Score=129.01 Aligned_cols=146 Identities=18% Similarity=0.260 Sum_probs=115.7
Q ss_pred eEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee---
Q 040274 71 DLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL--- 147 (359)
Q Consensus 71 ~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~--- 147 (359)
-+++|+++|..+++|+.||++++|+..+...+.....|.+.|.++.|+|||.+|++.+.| ...|||.+++.++...
T Consensus 148 k~vaf~~~gs~latgg~dg~lRv~~~Ps~~t~l~e~~~~~eV~DL~FS~dgk~lasig~d-~~~VW~~~~g~~~a~~t~~ 226 (398)
T KOG0771|consen 148 KVVAFNGDGSKLATGGTDGTLRVWEWPSMLTILEEIAHHAEVKDLDFSPDGKFLASIGAD-SARVWSVNTGAALARKTPF 226 (398)
T ss_pred eEEEEcCCCCEeeeccccceEEEEecCcchhhhhhHhhcCccccceeCCCCcEEEEecCC-ceEEEEeccCchhhhcCCc
Confidence 689999999999999999999999977777777788999999999999999999999999 8999998876211100
Q ss_pred ----------------------------------------cC--------------CceeEEEcCCC--cEEEEcCCcEE
Q 040274 148 ----------------------------------------TG--------------HAKTLDFSQKG--LLAVGTGSFAQ 171 (359)
Q Consensus 148 ----------------------------------------~~--------------~v~~~~~s~~g--l~~~~~d~~i~ 171 (359)
.+ .|++++.|++| ++.++.+|.|-
T Consensus 227 ~k~~~~~~cRF~~d~~~~~l~laa~~~~~~~v~~~~~~~w~~~~~l~~~~~~~~~~siSsl~VS~dGkf~AlGT~dGsVa 306 (398)
T KOG0771|consen 227 SKDEMFSSCRFSVDNAQETLRLAASQFPGGGVRLCDISLWSGSNFLRLRKKIKRFKSISSLAVSDDGKFLALGTMDGSVA 306 (398)
T ss_pred ccchhhhhceecccCCCceEEEEEecCCCCceeEEEeeeeccccccchhhhhhccCcceeEEEcCCCcEEEEeccCCcEE
Confidence 01 36889999999 55566799999
Q ss_pred EEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 172 ILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 172 v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
||+...-......-.. |...|+.+.|+|+.+++++.+.+....++.
T Consensus 307 i~~~~~lq~~~~vk~a----H~~~VT~ltF~Pdsr~~~svSs~~~~~v~~ 352 (398)
T KOG0771|consen 307 IYDAKSLQRLQYVKEA----HLGFVTGLTFSPDSRYLASVSSDNEAAVTK 352 (398)
T ss_pred EEEeceeeeeEeehhh----heeeeeeEEEcCCcCcccccccCCceeEEE
Confidence 9996443222222223 445899999999999999988887766653
No 160
>KOG2106 consensus Uncharacterized conserved protein, contains HELP and WD40 domains [Function unknown]
Probab=99.60 E-value=8.4e-14 Score=125.55 Aligned_cols=148 Identities=15% Similarity=0.170 Sum_probs=124.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee-
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL- 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~- 147 (359)
....++.+|+...++|++.|+.|++|+ ..+++.+.. -..++.|+.|+|.| .+|.|+..|...+.|..+...+...
T Consensus 370 elwgla~hps~~q~~T~gqdk~v~lW~--~~k~~wt~~-~~d~~~~~~fhpsg-~va~Gt~~G~w~V~d~e~~~lv~~~~ 445 (626)
T KOG2106|consen 370 ELWGLATHPSKNQLLTCGQDKHVRLWN--DHKLEWTKI-IEDPAECADFHPSG-VVAVGTATGRWFVLDTETQDLVTIHT 445 (626)
T ss_pred ceeeEEcCCChhheeeccCcceEEEcc--CCceeEEEE-ecCceeEeeccCcc-eEEEeeccceEEEEecccceeEEEEe
Confidence 678899999999999999999999999 445555433 36788999999999 9999999999999999986554433
Q ss_pred -cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 148 -TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 148 -~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
..+++++.|+|+| ++.++.|+.|+||-+..++..+..+..+ ++++|+.+.||+|+++|.+-+.|--+-+|.++
T Consensus 446 d~~~ls~v~ysp~G~~lAvgs~d~~iyiy~Vs~~g~~y~r~~k~---~gs~ithLDwS~Ds~~~~~~S~d~eiLyW~~~ 521 (626)
T KOG2106|consen 446 DNEQLSVVRYSPDGAFLAVGSHDNHIYIYRVSANGRKYSRVGKC---SGSPITHLDWSSDSQFLVSNSGDYEILYWKPS 521 (626)
T ss_pred cCCceEEEEEcCCCCEEEEecCCCeEEEEEECCCCcEEEEeeee---cCceeEEeeecCCCceEEeccCceEEEEEccc
Confidence 5678999999999 6667789999999987777777776666 44789999999999999999999888888654
No 161
>KOG4378 consensus Nuclear protein COP1 [Signal transduction mechanisms]
Probab=99.59 E-value=2.8e-14 Score=128.34 Aligned_cols=150 Identities=22% Similarity=0.348 Sum_probs=125.1
Q ss_pred eEEEECCCCCEEEEecc------------------------ceeEEEEcCCCC-EEEEEeCCCeEEEEeCCCCcceEEee
Q 040274 52 ILWILPSSGRYMAVAGR------------------------RTDLMRVNPFNG-VVSLGHSGGTVTMWKPTTSALLIKML 106 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------~v~~l~~sp~~~-~l~tg~~dg~v~lwd~~~~~~~~~~~ 106 (359)
.++.+.....|||+++. .|.-+.|+|... +|.+++.+|.|.+||+....++..+.
T Consensus 125 t~v~YN~~DeyiAsvs~gGdiiih~~~t~~~tt~f~~~sgqsvRll~ys~skr~lL~~asd~G~VtlwDv~g~sp~~~~~ 204 (673)
T KOG4378|consen 125 TYVDYNNTDEYIASVSDGGDIIIHGTKTKQKTTTFTIDSGQSVRLLRYSPSKRFLLSIASDKGAVTLWDVQGMSPIFHAS 204 (673)
T ss_pred EEEEecCCcceeEEeccCCcEEEEecccCccccceecCCCCeEEEeecccccceeeEeeccCCeEEEEeccCCCcccchh
Confidence 77777777888887655 577899999655 57788999999999999888777654
Q ss_pred -cCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCc
Q 040274 107 -YHQGPVSALAFHP-NGHLMATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSH 180 (359)
Q Consensus 107 -~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~ 180 (359)
.|..+...++|+| +..+|++.|.|..|.+||++.......+ ..+.++++|+++| |++|+..|.|..||++....
T Consensus 205 ~~HsAP~~gicfspsne~l~vsVG~Dkki~~yD~~s~~s~~~l~y~~Plstvaf~~~G~~L~aG~s~G~~i~YD~R~~k~ 284 (673)
T KOG4378|consen 205 EAHSAPCRGICFSPSNEALLVSVGYDKKINIYDIRSQASTDRLTYSHPLSTVAFSECGTYLCAGNSKGELIAYDMRSTKA 284 (673)
T ss_pred hhccCCcCcceecCCccceEEEecccceEEEeecccccccceeeecCCcceeeecCCceEEEeecCCceEEEEecccCCC
Confidence 7999999999999 5677999999999999999976655544 6778999999999 66667789999999988877
Q ss_pred cccccccccCCCCcceeEEEEccCC
Q 040274 181 NYSRYMGNSMVKGYQIGKVSFRPYE 205 (359)
Q Consensus 181 ~~~~~~~~~~~~~~~v~~~~~sp~~ 205 (359)
++..+..|.. .|++++|-|.-
T Consensus 285 Pv~v~sah~~----sVt~vafq~s~ 305 (673)
T KOG4378|consen 285 PVAVRSAHDA----SVTRVAFQPSP 305 (673)
T ss_pred CceEeeeccc----ceeEEEeeecc
Confidence 8878777754 79999998864
No 162
>KOG0321 consensus WD40 repeat-containing protein L2DTL [Function unknown]
Probab=99.59 E-value=3.2e-14 Score=131.49 Aligned_cols=186 Identities=17% Similarity=0.162 Sum_probs=126.3
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCC-CCEEEEEeCCCeEEEEeCCCCc-----
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPF-NGVVSLGHSGGTVTMWKPTTSA----- 100 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~-~~~l~tg~~dg~v~lwd~~~~~----- 100 (359)
|++.|-|....|++++. .|-+++|+|. ...|++|+.||.|.|||++-..
T Consensus 104 fDl~wapge~~lVsasGDsT~r~Wdvk~s~l~G~~~~~GH~~SvkS~cf~~~n~~vF~tGgRDg~illWD~R~n~~d~~e 183 (720)
T KOG0321|consen 104 FDLKWAPGESLLVSASGDSTIRPWDVKTSRLVGGRLNLGHTGSVKSECFMPTNPAVFCTGGRDGEILLWDCRCNGVDALE 183 (720)
T ss_pred EeeccCCCceeEEEccCCceeeeeeeccceeecceeecccccccchhhhccCCCcceeeccCCCcEEEEEEeccchhhHH
Confidence 99999994445555433 7899999994 5689999999999999975221
Q ss_pred ----------------------ceEEeecCCCCeEE---EEEecCCCEEEEecC-CCeEEEEEcCCCeeeEee-------
Q 040274 101 ----------------------LLIKMLYHQGPVSA---LAFHPNGHLMATTGK-ECKIKIWDLRKYEVLQTL------- 147 (359)
Q Consensus 101 ----------------------~~~~~~~h~~~v~~---l~~~p~g~~l~s~~~-d~~i~vwd~~~~~~~~~~------- 147 (359)
.+....+|...|.+ +.+..|...||++|. |+.|+|||++........
T Consensus 184 ~~~~~~~~~~n~~ptpskp~~kr~~k~kA~s~ti~ssvTvv~fkDe~tlaSaga~D~~iKVWDLRk~~~~~r~ep~~~~~ 263 (720)
T KOG0321|consen 184 EFDNRIYGRHNTAPTPSKPLKKRIRKWKAASNTIFSSVTVVLFKDESTLASAGAADSTIKVWDLRKNYTAYRQEPRGSDK 263 (720)
T ss_pred HHhhhhhccccCCCCCCchhhccccccccccCceeeeeEEEEEeccceeeeccCCCcceEEEeecccccccccCCCcccC
Confidence 01122244445555 555678889999988 999999999975432222
Q ss_pred -cC------CceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccc-cccccccCCCCcceeEEEEccCCCEEEEEeCCCeE
Q 040274 148 -TG------HAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNY-SRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWS 217 (359)
Q Consensus 148 -~~------~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~-~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~ 217 (359)
.. .++++.....| +++.+.|+.|++|++....... ..+.++. .......-..+||+.+|++|+.|...
T Consensus 264 ~~t~skrs~G~~nL~lDssGt~L~AsCtD~sIy~ynm~s~s~sP~~~~sg~~--~~sf~vks~lSpd~~~l~SgSsd~~a 341 (720)
T KOG0321|consen 264 YPTHSKRSVGQVNLILDSSGTYLFASCTDNSIYFYNMRSLSISPVAEFSGKL--NSSFYVKSELSPDDCSLLSGSSDEQA 341 (720)
T ss_pred ccCcccceeeeEEEEecCCCCeEEEEecCCcEEEEeccccCcCchhhccCcc--cceeeeeeecCCCCceEeccCCCcce
Confidence 11 25677777778 7788889999999986643322 2222321 11112223467899999999999876
Q ss_pred EE--------------------------------EEcCCCCCceeeeccCCCCC
Q 040274 218 GI--------------------------------LVPRSSEPNFDSWVANPFET 239 (359)
Q Consensus 218 ~i--------------------------------~~~gs~~~~~~~~~~~~~~~ 239 (359)
.+ +++.+.|..+++|...+...
T Consensus 342 yiw~vs~~e~~~~~l~Ght~eVt~V~w~pS~~t~v~TcSdD~~~kiW~l~~~l~ 395 (720)
T KOG0321|consen 342 YIWVVSSPEAPPALLLGHTREVTTVRWLPSATTPVATCSDDFRVKIWRLSNGLE 395 (720)
T ss_pred eeeeecCccCChhhhhCcceEEEEEeeccccCCCceeeccCcceEEEeccCchh
Confidence 65 35567788888888765433
No 163
>KOG1539 consensus WD repeat protein [General function prediction only]
Probab=99.59 E-value=2.8e-14 Score=135.46 Aligned_cols=148 Identities=16% Similarity=0.214 Sum_probs=130.2
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEe---ecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeE
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKM---LYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQ 145 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~---~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~ 145 (359)
.+++++.++.|++.+.|+..|+|.+|++.+|-...+| ..|.++|++++.+.-++.+++++.+|.+++||.....++.
T Consensus 450 ~~~av~vs~CGNF~~IG~S~G~Id~fNmQSGi~r~sf~~~~ah~~~V~gla~D~~n~~~vsa~~~Gilkfw~f~~k~l~~ 529 (910)
T KOG1539|consen 450 NATAVCVSFCGNFVFIGYSKGTIDRFNMQSGIHRKSFGDSPAHKGEVTGLAVDGTNRLLVSAGADGILKFWDFKKKVLKK 529 (910)
T ss_pred ceEEEEEeccCceEEEeccCCeEEEEEcccCeeecccccCccccCceeEEEecCCCceEEEccCcceEEEEecCCcceee
Confidence 7899999999999999999999999999999888787 4899999999999888999999999999999999888777
Q ss_pred ee--cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 146 TL--TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 146 ~~--~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
.+ ...+.++.++... ++.+..|-.|.++|+.+. ..+..+.+|.. .|++++|||||+||++++.|+++++|.
T Consensus 530 ~l~l~~~~~~iv~hr~s~l~a~~~ddf~I~vvD~~t~-kvvR~f~gh~n----ritd~~FS~DgrWlisasmD~tIr~wD 604 (910)
T KOG1539|consen 530 SLRLGSSITGIVYHRVSDLLAIALDDFSIRVVDVVTR-KVVREFWGHGN----RITDMTFSPDGRWLISASMDSTIRTWD 604 (910)
T ss_pred eeccCCCcceeeeeehhhhhhhhcCceeEEEEEchhh-hhhHHhhcccc----ceeeeEeCCCCcEEEEeecCCcEEEEe
Confidence 77 4567888887766 566667789999996554 67777888765 899999999999999999999999874
No 164
>PF08662 eIF2A: Eukaryotic translation initiation factor eIF2A; InterPro: IPR013979 This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins.
Probab=99.59 E-value=8.2e-14 Score=117.06 Aligned_cols=121 Identities=18% Similarity=0.319 Sum_probs=96.3
Q ss_pred eEEEECCCCCEEEEecc-----------------------------------ceeEEEEcCCCCEEEEE--eCCCeEEEE
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------------------RTDLMRVNPFNGVVSLG--HSGGTVTMW 94 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------------------~v~~l~~sp~~~~l~tg--~~dg~v~lw 94 (359)
-.|.|+|+|.+|++-.. +|.+++|+|+|..|++. ..++.|.+|
T Consensus 9 ~~~~W~~~G~~l~~~~~~~~~~~~ks~~~~~~l~~~~~~~~~~~~i~l~~~~~I~~~~WsP~g~~favi~g~~~~~v~ly 88 (194)
T PF08662_consen 9 AKLHWQPSGDYLLVKVQTRVDKSGKSYYGEFELFYLNEKNIPVESIELKKEGPIHDVAWSPNGNEFAVIYGSMPAKVTLY 88 (194)
T ss_pred EEEEecccCCEEEEEEEEeeccCcceEEeeEEEEEEecCCCccceeeccCCCceEEEEECcCCCEEEEEEccCCcccEEE
Confidence 56889999998875332 69999999999886554 467799999
Q ss_pred eCCCCcceEEeecCCCCeEEEEEecCCCEEEEecC---CCeEEEEEcCCCeeeEeec-CCceeEEEcCCC--cEEEEc--
Q 040274 95 KPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGK---ECKIKIWDLRKYEVLQTLT-GHAKTLDFSQKG--LLAVGT-- 166 (359)
Q Consensus 95 d~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~---d~~i~vwd~~~~~~~~~~~-~~v~~~~~s~~g--l~~~~~-- 166 (359)
|+. +..+..+ +...++.+.|+|+|++|++++. .|.|.+||+++.+.+.++. ..++.++|||+| +++++.
T Consensus 89 d~~-~~~i~~~--~~~~~n~i~wsP~G~~l~~~g~~n~~G~l~~wd~~~~~~i~~~~~~~~t~~~WsPdGr~~~ta~t~~ 165 (194)
T PF08662_consen 89 DVK-GKKIFSF--GTQPRNTISWSPDGRFLVLAGFGNLNGDLEFWDVRKKKKISTFEHSDATDVEWSPDGRYLATATTSP 165 (194)
T ss_pred cCc-ccEeEee--cCCCceEEEECCCCCEEEEEEccCCCcEEEEEECCCCEEeeccccCcEEEEEEcCCCCEEEEEEecc
Confidence 997 5666665 3567889999999999999874 4679999999998888873 447899999999 444443
Q ss_pred ----CCcEEEEcC
Q 040274 167 ----GSFAQILGD 175 (359)
Q Consensus 167 ----d~~i~v~d~ 175 (359)
|+.+.||+.
T Consensus 166 r~~~dng~~Iw~~ 178 (194)
T PF08662_consen 166 RLRVDNGFKIWSF 178 (194)
T ss_pred ceeccccEEEEEe
Confidence 678899984
No 165
>PF08662 eIF2A: Eukaryotic translation initiation factor eIF2A; InterPro: IPR013979 This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins.
Probab=99.59 E-value=1.7e-13 Score=115.21 Aligned_cols=151 Identities=17% Similarity=0.288 Sum_probs=103.9
Q ss_pred eEEEEcCCCCEEEEEeC----------CCeEEEEeCCC-CcceEEee-cCCCCeEEEEEecCCCEEEEe--cCCCeEEEE
Q 040274 71 DLMRVNPFNGVVSLGHS----------GGTVTMWKPTT-SALLIKML-YHQGPVSALAFHPNGHLMATT--GKECKIKIW 136 (359)
Q Consensus 71 ~~l~~sp~~~~l~tg~~----------dg~v~lwd~~~-~~~~~~~~-~h~~~v~~l~~~p~g~~l~s~--~~d~~i~vw 136 (359)
..|.|+|+|.+|++-.. -|...+|.++. +.++..+. ...++|.+++|+|+|..|+++ ..+..|.+|
T Consensus 9 ~~~~W~~~G~~l~~~~~~~~~~~~ks~~~~~~l~~~~~~~~~~~~i~l~~~~~I~~~~WsP~g~~favi~g~~~~~v~ly 88 (194)
T PF08662_consen 9 AKLHWQPSGDYLLVKVQTRVDKSGKSYYGEFELFYLNEKNIPVESIELKKEGPIHDVAWSPNGNEFAVIYGSMPAKVTLY 88 (194)
T ss_pred EEEEecccCCEEEEEEEEeeccCcceEEeeEEEEEEecCCCccceeeccCCCceEEEEECcCCCEEEEEEccCCcccEEE
Confidence 36889999987655332 13455565532 23444443 345679999999999987554 457799999
Q ss_pred EcCCCeeeEee-cCCceeEEEcCCC--cEEEEcC---CcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEE
Q 040274 137 DLRKYEVLQTL-TGHAKTLDFSQKG--LLAVGTG---SFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGI 210 (359)
Q Consensus 137 d~~~~~~~~~~-~~~v~~~~~s~~g--l~~~~~d---~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~ 210 (359)
|+. ++.+..+ ..+++.+.|||+| +++++.+ |.|.+||+... ..+... .|. .++.++|+|+|++|++
T Consensus 89 d~~-~~~i~~~~~~~~n~i~wsP~G~~l~~~g~~n~~G~l~~wd~~~~-~~i~~~-~~~-----~~t~~~WsPdGr~~~t 160 (194)
T PF08662_consen 89 DVK-GKKIFSFGTQPRNTISWSPDGRFLVLAGFGNLNGDLEFWDVRKK-KKISTF-EHS-----DATDVEWSPDGRYLAT 160 (194)
T ss_pred cCc-ccEeEeecCCCceEEEECCCCCEEEEEEccCCCcEEEEEECCCC-EEeecc-ccC-----cEEEEEEcCCCCEEEE
Confidence 997 7777777 5568899999999 5555543 67999997533 333222 221 4789999999999999
Q ss_pred EeCCCeEEEEEcCCCCCceeeeccC
Q 040274 211 GHSMGWSGILVPRSSEPNFDSWVAN 235 (359)
Q Consensus 211 g~~dg~~~i~~~gs~~~~~~~~~~~ 235 (359)
++.... -..|+.+++|..+
T Consensus 161 a~t~~r------~~~dng~~Iw~~~ 179 (194)
T PF08662_consen 161 ATTSPR------LRVDNGFKIWSFQ 179 (194)
T ss_pred EEeccc------eeccccEEEEEec
Confidence 876432 1246678888754
No 166
>KOG1009 consensus Chromatin assembly complex 1 subunit B/CAC2 (contains WD40 repeats) [Chromatin structure and dynamics; Replication, recombination and repair]
Probab=99.58 E-value=4.4e-14 Score=124.23 Aligned_cols=95 Identities=20% Similarity=0.407 Sum_probs=78.7
Q ss_pred eEEEECCCCC-EEEEecc--------------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCC-
Q 040274 52 ILWILPSSGR-YMAVAGR--------------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPT- 97 (359)
Q Consensus 52 ~~l~~spdg~-~l~~~~~--------------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~- 97 (359)
+++.|++++. .|++||. .|+++.|+|+|.+|++|+.+|.|.+|-..
T Consensus 17 ~s~dfq~n~~~~laT~G~D~~iriW~v~r~~~~~~~~~V~y~s~Ls~H~~aVN~vRf~p~gelLASg~D~g~v~lWk~~~ 96 (434)
T KOG1009|consen 17 YSVDFQKNSLNKLATAGGDKDIRIWKVNRSEPGGGDMKVEYLSSLSRHTRAVNVVRFSPDGELLASGGDGGEVFLWKQGD 96 (434)
T ss_pred EEEEeccCcccceecccCccceeeeeeeecCCCCCceeEEEeecccCCcceeEEEEEcCCcCeeeecCCCceEEEEEecC
Confidence 6777777666 7777765 89999999999999999999999999765
Q ss_pred -------C--------CcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEe
Q 040274 98 -------T--------SALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQT 146 (359)
Q Consensus 98 -------~--------~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~ 146 (359)
+ ......+.+|...|..++|+|++.++++++.|..+++||+..|..+..
T Consensus 97 ~~~~~~d~e~~~~ke~w~v~k~lr~h~~diydL~Ws~d~~~l~s~s~dns~~l~Dv~~G~l~~~ 160 (434)
T KOG1009|consen 97 VRIFDADTEADLNKEKWVVKKVLRGHRDDIYDLAWSPDSNFLVSGSVDNSVRLWDVHAGQLLAI 160 (434)
T ss_pred cCCccccchhhhCccceEEEEEecccccchhhhhccCCCceeeeeeccceEEEEEeccceeEee
Confidence 2 122345668999999999999999999999999999999876655433
No 167
>KOG0307 consensus Vesicle coat complex COPII, subunit SEC31 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.57 E-value=6.4e-15 Score=144.22 Aligned_cols=144 Identities=22% Similarity=0.329 Sum_probs=109.7
Q ss_pred ceeEEEEcCCCCE----EEEEeCCCeEEEEeCCC---C---cceEEeecCCCCeEEEEEecC-CCEEEEecCCCeEEEEE
Q 040274 69 RTDLMRVNPFNGV----VSLGHSGGTVTMWKPTT---S---ALLIKMLYHQGPVSALAFHPN-GHLMATTGKECKIKIWD 137 (359)
Q Consensus 69 ~v~~l~~sp~~~~----l~tg~~dg~v~lwd~~~---~---~~~~~~~~h~~~v~~l~~~p~-g~~l~s~~~d~~i~vwd 137 (359)
..+.++|.+.+.. |+.|..||.|.+||+.. + ..+.++..|++.|..+.|++. +++||+|+.||.|.|||
T Consensus 66 rF~kL~W~~~g~~~~GlIaGG~edG~I~ly~p~~~~~~~~~~~la~~~~h~G~V~gLDfN~~q~nlLASGa~~geI~iWD 145 (1049)
T KOG0307|consen 66 RFNKLAWGSYGSHSHGLIAGGLEDGNIVLYDPASIIANASEEVLATKSKHTGPVLGLDFNPFQGNLLASGADDGEILIWD 145 (1049)
T ss_pred cceeeeecccCCCccceeeccccCCceEEecchhhccCcchHHHhhhcccCCceeeeeccccCCceeeccCCCCcEEEec
Confidence 7899999986654 88899999999999875 2 345567789999999999995 45999999999999999
Q ss_pred cCCCeeeEee-----cCCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCC-CEE
Q 040274 138 LRKYEVLQTL-----TGHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYE-DVL 208 (359)
Q Consensus 138 ~~~~~~~~~~-----~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~-~~l 208 (359)
+...+.-.++ .+.|.+++|+..- |.+++.+|.+.|||++.. +.+..+..+. ....+..+.|+|+. ..|
T Consensus 146 lnn~~tP~~~~~~~~~~eI~~lsWNrkvqhILAS~s~sg~~~iWDlr~~-~pii~ls~~~--~~~~~S~l~WhP~~aTql 222 (1049)
T KOG0307|consen 146 LNKPETPFTPGSQAPPSEIKCLSWNRKVSHILASGSPSGRAVIWDLRKK-KPIIKLSDTP--GRMHCSVLAWHPDHATQL 222 (1049)
T ss_pred cCCcCCCCCCCCCCCcccceEeccchhhhHHhhccCCCCCceeccccCC-CcccccccCC--CccceeeeeeCCCCceee
Confidence 9875543333 4568999999876 666777889999998766 3443333332 11358899999987 446
Q ss_pred EEEeCCC
Q 040274 209 GIGHSMG 215 (359)
Q Consensus 209 ~~g~~dg 215 (359)
++++.|.
T Consensus 223 ~~As~dd 229 (1049)
T KOG0307|consen 223 LVASGDD 229 (1049)
T ss_pred eeecCCC
Confidence 6666554
No 168
>KOG1063 consensus RNA polymerase II elongator complex, subunit ELP2, WD repeat superfamily [Chromatin structure and dynamics; Transcription]
Probab=99.56 E-value=1.1e-13 Score=128.98 Aligned_cols=149 Identities=11% Similarity=0.218 Sum_probs=117.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCC-----eEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCe-
Q 040274 69 RTDLMRVNPFNGVVSLGHSGG-----TVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYE- 142 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg-----~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~- 142 (359)
.|.|++.||+++++++++... .|++|+..+...+..+.+|.-.|+.++|||||++|++++.|+++.+|......
T Consensus 527 Ev~~l~~s~~gnliASaCKS~~~ehAvI~lw~t~~W~~~~~L~~HsLTVT~l~FSpdg~~LLsvsRDRt~sl~~~~~~~~ 606 (764)
T KOG1063|consen 527 EVYALAISPTGNLIASACKSSLKEHAVIRLWNTANWLQVQELEGHSLTVTRLAFSPDGRYLLSVSRDRTVSLYEVQEDIK 606 (764)
T ss_pred eEEEEEecCCCCEEeehhhhCCccceEEEEEeccchhhhheecccceEEEEEEECCCCcEEEEeecCceEEeeeeecccc
Confidence 899999999999999998543 59999999888888899999999999999999999999999999999874321
Q ss_pred eeEee---cCC---ceeEEEcCCC--cEEEEcCCcEEEEcCCCCC--cccc-ccccccCCCCcceeEEEEccC-----CC
Q 040274 143 VLQTL---TGH---AKTLDFSQKG--LLAVGTGSFAQILGDFSGS--HNYS-RYMGNSMVKGYQIGKVSFRPY-----ED 206 (359)
Q Consensus 143 ~~~~~---~~~---v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~--~~~~-~~~~~~~~~~~~v~~~~~sp~-----~~ 206 (359)
.-..| ..| |++++|+|++ ++++|.|..|.||...... .... .... ++..|+.++|.|- +.
T Consensus 607 ~e~~fa~~k~HtRIIWdcsW~pde~~FaTaSRDK~VkVW~~~~~~d~~i~~~a~~~----~~~aVTAv~~~~~~~~e~~~ 682 (764)
T KOG1063|consen 607 DEFRFACLKAHTRIIWDCSWSPDEKYFATASRDKKVKVWEEPDLRDKYISRFACLK----FSLAVTAVAYLPVDHNEKGD 682 (764)
T ss_pred hhhhhccccccceEEEEcccCcccceeEEecCCceEEEEeccCchhhhhhhhchhc----cCCceeeEEeeccccccccc
Confidence 11111 222 7999999999 8899999999999855441 1111 1122 4458999999872 34
Q ss_pred EEEEEeCCCeEEEEE
Q 040274 207 VLGIGHSMGWSGILV 221 (359)
Q Consensus 207 ~l~~g~~dg~~~i~~ 221 (359)
++++|-..|-+.+|-
T Consensus 683 ~vavGle~GeI~l~~ 697 (764)
T KOG1063|consen 683 VVAVGLEKGEIVLWR 697 (764)
T ss_pred eEEEEecccEEEEEe
Confidence 788899999887776
No 169
>KOG2394 consensus WD40 protein DMR-N9 [General function prediction only]
Probab=99.55 E-value=1.1e-13 Score=125.71 Aligned_cols=130 Identities=18% Similarity=0.355 Sum_probs=102.9
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCC----------------------------CcceEEeecCCCCeEEEEEec
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTT----------------------------SALLIKMLYHQGPVSALAFHP 119 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~----------------------------~~~~~~~~~h~~~v~~l~~~p 119 (359)
.|+|+.|-| +...++++..+|.+++||..- ..++..+.-..+.|+..+|+|
T Consensus 221 svT~ikWvpg~~~~Fl~a~~sGnlyly~~~~~~~~t~p~~~~~k~~~~f~i~t~ksk~~rNPv~~w~~~~g~in~f~FS~ 300 (636)
T KOG2394|consen 221 SVTCIKWVPGSDSLFLVAHASGNLYLYDKEIVCGATAPSYQALKDGDQFAILTSKSKKTRNPVARWHIGEGSINEFAFSP 300 (636)
T ss_pred ceEEEEEEeCCCceEEEEEecCceEEeeccccccCCCCcccccCCCCeeEEeeeeccccCCccceeEeccccccceeEcC
Confidence 799999999 556788888999999996420 112333333356789999999
Q ss_pred CCCEEEEecCCCeEEEEEcCCCeeeE---eecCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCc
Q 040274 120 NGHLMATTGKECKIKIWDLRKYEVLQ---TLTGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGY 194 (359)
Q Consensus 120 ~g~~l~s~~~d~~i~vwd~~~~~~~~---~~~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~ 194 (359)
||.+||+.+.||.++|||..+.+++. ++-+...|++||||| +++++.|.-|.||.+... +.+..-.+|..
T Consensus 301 DG~~LA~VSqDGfLRvF~fdt~eLlg~mkSYFGGLLCvcWSPDGKyIvtGGEDDLVtVwSf~er-RVVARGqGHkS---- 375 (636)
T KOG2394|consen 301 DGKYLATVSQDGFLRIFDFDTQELLGVMKSYFGGLLCVCWSPDGKYIVTGGEDDLVTVWSFEER-RVVARGQGHKS---- 375 (636)
T ss_pred CCceEEEEecCceEEEeeccHHHHHHHHHhhccceEEEEEcCCccEEEecCCcceEEEEEeccc-eEEEecccccc----
Confidence 99999999999999999999876544 446778999999999 788889999999996443 56655566654
Q ss_pred ceeEEEEcc
Q 040274 195 QIGKVSFRP 203 (359)
Q Consensus 195 ~v~~~~~sp 203 (359)
+|+.++|.|
T Consensus 376 WVs~VaFDp 384 (636)
T KOG2394|consen 376 WVSVVAFDP 384 (636)
T ss_pred ceeeEeecc
Confidence 999999997
No 170
>KOG0321 consensus WD40 repeat-containing protein L2DTL [Function unknown]
Probab=99.55 E-value=1.9e-13 Score=126.48 Aligned_cols=168 Identities=19% Similarity=0.217 Sum_probs=125.7
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEE--eecCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCCCe---
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIK--MLYHQGPVSALAFHP-NGHLMATTGKECKIKIWDLRKYE--- 142 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~--~~~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~~~--- 142 (359)
.|..+.|-|....|++++.|.++++||+.++..+.. +.+|.+.|.+++|.| +...|++|+.||.|.|||++-..
T Consensus 102 AifDl~wapge~~lVsasGDsT~r~Wdvk~s~l~G~~~~~GH~~SvkS~cf~~~n~~vF~tGgRDg~illWD~R~n~~d~ 181 (720)
T KOG0321|consen 102 AIFDLKWAPGESLLVSASGDSTIRPWDVKTSRLVGGRLNLGHTGSVKSECFMPTNPAVFCTGGRDGEILLWDCRCNGVDA 181 (720)
T ss_pred eeEeeccCCCceeEEEccCCceeeeeeeccceeecceeecccccccchhhhccCCCcceeeccCCCcEEEEEEeccchhh
Confidence 799999999667899999999999999999888766 889999999999999 45678999999999999986422
Q ss_pred -----------------eeEee--------------cCCceeEEEcCCC-cEEEEc-CCcEEEEcCCCCCcc-------c
Q 040274 143 -----------------VLQTL--------------TGHAKTLDFSQKG-LLAVGT-GSFAQILGDFSGSHN-------Y 182 (359)
Q Consensus 143 -----------------~~~~~--------------~~~v~~~~~s~~g-l~~~~~-d~~i~v~d~~~~~~~-------~ 182 (359)
+.... .+.|+.+.|-.+. ++++|. |+.|+|||++..... .
T Consensus 182 ~e~~~~~~~~~~n~~ptpskp~~kr~~k~kA~s~ti~ssvTvv~fkDe~tlaSaga~D~~iKVWDLRk~~~~~r~ep~~~ 261 (720)
T KOG0321|consen 182 LEEFDNRIYGRHNTAPTPSKPLKKRIRKWKAASNTIFSSVTVVLFKDESTLASAGAADSTIKVWDLRKNYTAYRQEPRGS 261 (720)
T ss_pred HHHHhhhhhccccCCCCCCchhhccccccccccCceeeeeEEEEEeccceeeeccCCCcceEEEeecccccccccCCCcc
Confidence 00000 1123445554444 777776 999999998764322 2
Q ss_pred cccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE----------------------------------EEcCCCCCc
Q 040274 183 SRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI----------------------------------LVPRSSEPN 228 (359)
Q Consensus 183 ~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i----------------------------------~~~gs~~~~ 228 (359)
..+..|.. ....+.++.....|.+|...+.|+.|.+ +++|+.+..
T Consensus 262 ~~~~t~sk-rs~G~~nL~lDssGt~L~AsCtD~sIy~ynm~s~s~sP~~~~sg~~~~sf~vks~lSpd~~~l~SgSsd~~ 340 (720)
T KOG0321|consen 262 DKYPTHSK-RSVGQVNLILDSSGTYLFASCTDNSIYFYNMRSLSISPVAEFSGKLNSSFYVKSELSPDDCSLLSGSSDEQ 340 (720)
T ss_pred cCccCccc-ceeeeEEEEecCCCCeEEEEecCCcEEEEeccccCcCchhhccCcccceeeeeeecCCCCceEeccCCCcc
Confidence 23333321 2335888888899999988888988765 578888888
Q ss_pred eeeeccCCC
Q 040274 229 FDSWVANPF 237 (359)
Q Consensus 229 ~~~~~~~~~ 237 (359)
..+|.++..
T Consensus 341 ayiw~vs~~ 349 (720)
T KOG0321|consen 341 AYIWVVSSP 349 (720)
T ss_pred eeeeeecCc
Confidence 999987643
No 171
>KOG4328 consensus WD40 protein [Function unknown]
Probab=99.54 E-value=1e-13 Score=123.60 Aligned_cols=157 Identities=17% Similarity=0.241 Sum_probs=117.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcc-eEEeecCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCCCee---
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSAL-LIKMLYHQGPVSALAFHP-NGHLMATTGKECKIKIWDLRKYEV--- 143 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~-~~~~~~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~~~~--- 143 (359)
.+..+.|+.+...+++|..=|...+||.+++.. ...+..|...|++++++| ...+|+|+|.|++++|||+|....
T Consensus 281 ~fs~~d~~~e~~~vl~~~~~G~f~~iD~R~~~s~~~~~~lh~kKI~sv~~NP~~p~~laT~s~D~T~kIWD~R~l~~K~s 360 (498)
T KOG4328|consen 281 WFSSLDFSAESRSVLFGDNVGNFNVIDLRTDGSEYENLRLHKKKITSVALNPVCPWFLATASLDQTAKIWDLRQLRGKAS 360 (498)
T ss_pred eeeeccccCCCccEEEeecccceEEEEeecCCccchhhhhhhcccceeecCCCCchheeecccCcceeeeehhhhcCCCC
Confidence 567788888888888888778999999998755 556678999999999999 455799999999999999997432
Q ss_pred --eEee--cCCceeEEEcCCC--cEEEEcCCcEEEEcCC---CCCccccccccccCCCCc--ceeEEEEccCCCEEEEEe
Q 040274 144 --LQTL--TGHAKTLDFSQKG--LLAVGTGSFAQILGDF---SGSHNYSRYMGNSMVKGY--QIGKVSFRPYEDVLGIGH 212 (359)
Q Consensus 144 --~~~~--~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~---~~~~~~~~~~~~~~~~~~--~v~~~~~sp~~~~l~~g~ 212 (359)
+.++ ...|.+..|||+| +++.+.|+.|+|||.. ........ ..|...++. ...-..|.|+..++++|.
T Consensus 361 p~lst~~HrrsV~sAyFSPs~gtl~TT~~D~~IRv~dss~~sa~~~p~~~-I~Hn~~t~RwlT~fKA~W~P~~~li~vg~ 439 (498)
T KOG4328|consen 361 PFLSTLPHRRSVNSAYFSPSGGTLLTTCQDNEIRVFDSSCISAKDEPLGT-IPHNNRTGRWLTPFKAAWDPDYNLIVVGR 439 (498)
T ss_pred cceecccccceeeeeEEcCCCCceEeeccCCceEEeecccccccCCccce-eeccCcccccccchhheeCCCccEEEEec
Confidence 3344 3458999999998 9999999999999962 11111111 122221222 244568999999999999
Q ss_pred CCCeEEEEEcCCCC
Q 040274 213 SMGWSGILVPRSSE 226 (359)
Q Consensus 213 ~dg~~~i~~~gs~~ 226 (359)
.-.-|.|+.+..+.
T Consensus 440 ~~r~IDv~~~~~~q 453 (498)
T KOG4328|consen 440 YPRPIDVFDGNGGQ 453 (498)
T ss_pred cCcceeEEcCCCCE
Confidence 88877777765544
No 172
>KOG1523 consensus Actin-related protein Arp2/3 complex, subunit ARPC1/p41-ARC [Cytoskeleton]
Probab=99.54 E-value=1.5e-13 Score=117.56 Aligned_cols=151 Identities=10% Similarity=0.119 Sum_probs=118.6
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCC---cceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCC-e--
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTS---ALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKY-E-- 142 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~---~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~-~-- 142 (359)
+|+|.+|++|...++++..+..|.||..... +...++..|...|++++|+|..+.|++|+.|..-+||....+ .
T Consensus 12 pitchAwn~drt~iAv~~~~~evhiy~~~~~~~w~~~htls~Hd~~vtgvdWap~snrIvtcs~drnayVw~~~~~~~Wk 91 (361)
T KOG1523|consen 12 PITCHAWNSDRTQIAVSPNNHEVHIYSMLGADLWEPAHTLSEHDKIVTGVDWAPKSNRIVTCSHDRNAYVWTQPSGGTWK 91 (361)
T ss_pred ceeeeeecCCCceEEeccCCceEEEEEecCCCCceeceehhhhCcceeEEeecCCCCceeEccCCCCccccccCCCCeec
Confidence 7999999999999999999999999987654 467888899999999999999999999999999999998543 2
Q ss_pred e---eEeecCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeE
Q 040274 143 V---LQTLTGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWS 217 (359)
Q Consensus 143 ~---~~~~~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~ 217 (359)
+ +..+...++++.|+|.+ +++++....|.||=. ..+...-.......+..+.|++++|+|++-+|+.|+.|+..
T Consensus 92 ptlvLlRiNrAAt~V~WsP~enkFAVgSgar~isVcy~-E~ENdWWVsKhikkPirStv~sldWhpnnVLlaaGs~D~k~ 170 (361)
T KOG1523|consen 92 PTLVLLRINRAATCVKWSPKENKFAVGSGARLISVCYY-EQENDWWVSKHIKKPIRSTVTSLDWHPNNVLLAAGSTDGKC 170 (361)
T ss_pred cceeEEEeccceeeEeecCcCceEEeccCccEEEEEEE-ecccceehhhhhCCccccceeeeeccCCcceecccccCcce
Confidence 2 33447789999999999 666666677777753 22222211111111244579999999999999999999988
Q ss_pred EEE
Q 040274 218 GIL 220 (359)
Q Consensus 218 ~i~ 220 (359)
++|
T Consensus 171 rVf 173 (361)
T KOG1523|consen 171 RVF 173 (361)
T ss_pred eEE
Confidence 774
No 173
>KOG1523 consensus Actin-related protein Arp2/3 complex, subunit ARPC1/p41-ARC [Cytoskeleton]
Probab=99.53 E-value=3.5e-13 Score=115.39 Aligned_cols=175 Identities=11% Similarity=0.139 Sum_probs=135.9
Q ss_pred eEEEECCCCCEEEEecc--------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCC-C--cce
Q 040274 52 ILWILPSSGRYMAVAGR--------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTT-S--ALL 102 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~--------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~-~--~~~ 102 (359)
+|.+|++|+..+|++-. .|++++|+|..+.|++|+.|..-++|.... + ++.
T Consensus 14 tchAwn~drt~iAv~~~~~evhiy~~~~~~~w~~~htls~Hd~~vtgvdWap~snrIvtcs~drnayVw~~~~~~~Wkpt 93 (361)
T KOG1523|consen 14 TCHAWNSDRTQIAVSPNNHEVHIYSMLGADLWEPAHTLSEHDKIVTGVDWAPKSNRIVTCSHDRNAYVWTQPSGGTWKPT 93 (361)
T ss_pred eeeeecCCCceEEeccCCceEEEEEecCCCCceeceehhhhCcceeEEeecCCCCceeEccCCCCccccccCCCCeeccc
Confidence 89999999999988765 899999999999999999999999999833 3 566
Q ss_pred EEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCee------e-EeecCCceeEEEcCCC--cEEEEcCCcEEEE
Q 040274 103 IKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEV------L-QTLTGHAKTLDFSQKG--LLAVGTGSFAQIL 173 (359)
Q Consensus 103 ~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~------~-~~~~~~v~~~~~s~~g--l~~~~~d~~i~v~ 173 (359)
..+..++..++++.|+|.++.||+|+....|.||-+..-.- + ..+...|++++|+|++ +.+++.|+.++||
T Consensus 94 lvLlRiNrAAt~V~WsP~enkFAVgSgar~isVcy~E~ENdWWVsKhikkPirStv~sldWhpnnVLlaaGs~D~k~rVf 173 (361)
T KOG1523|consen 94 LVLLRINRAATCVKWSPKENKFAVGSGARLISVCYYEQENDWWVSKHIKKPIRSTVTSLDWHPNNVLLAAGSTDGKCRVF 173 (361)
T ss_pred eeEEEeccceeeEeecCcCceEEeccCccEEEEEEEecccceehhhhhCCccccceeeeeccCCcceecccccCcceeEE
Confidence 67778999999999999999999999999999997764221 1 1225678999999999 6677789999998
Q ss_pred cCCCC-----C--------ccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCC
Q 040274 174 GDFSG-----S--------HNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSE 226 (359)
Q Consensus 174 d~~~~-----~--------~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~ 226 (359)
...-. . .+...++......++.|..+.|+|.|..|+-.+.|+.+.+.......
T Consensus 174 SayIK~Vdekpap~pWgsk~PFG~lm~E~~~~ggwvh~v~fs~sG~~lawv~Hds~v~~~da~~p~ 239 (361)
T KOG1523|consen 174 SAYIKGVDEKPAPTPWGSKMPFGQLMSEASSSGGWVHGVLFSPSGNRLAWVGHDSTVSFVDAAGPS 239 (361)
T ss_pred EEeeeccccCCCCCCCccCCcHHHHHHhhccCCCceeeeEeCCCCCEeeEecCCCceEEeecCCCc
Confidence 73211 0 00111111110245589999999999999999999988887765543
No 174
>KOG1524 consensus WD40 repeat-containing protein CHE-2 [General function prediction only]
Probab=99.53 E-value=2.7e-13 Score=123.17 Aligned_cols=150 Identities=18% Similarity=0.215 Sum_probs=107.4
Q ss_pred eEEEECCCCCEEEEecc----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCC
Q 040274 52 ILWILPSSGRYMAVAGR----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQ 109 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~ 109 (359)
.+-.|+|||.-|+++|. +|.|++|.|+.+.++.+. .+.+.|=.+.....+..+.+|.
T Consensus 108 ~~gRW~~dGtgLlt~GEDG~iKiWSrsGMLRStl~Q~~~~v~c~~W~p~S~~vl~c~-g~h~~IKpL~~n~k~i~WkAHD 186 (737)
T KOG1524|consen 108 SSGRWSPDGAGLLTAGEDGVIKIWSRSGMLRSTVVQNEESIRCARWAPNSNSIVFCQ-GGHISIKPLAANSKIIRWRAHD 186 (737)
T ss_pred hhcccCCCCceeeeecCCceEEEEeccchHHHHHhhcCceeEEEEECCCCCceEEec-CCeEEEeecccccceeEEeccC
Confidence 45566677776666665 667777776554433332 2445555555455566778999
Q ss_pred CCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee---cCCceeEEEcCCCcEEEEcCCcEEEEcCCCCCccccccc
Q 040274 110 GPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL---TGHAKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYM 186 (359)
Q Consensus 110 ~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~---~~~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~ 186 (359)
+.|.++.|+|...++++||.|-..++||.. |..+.+- .-+|++++|.|+.+++.++-+++++=.
T Consensus 187 GiiL~~~W~~~s~lI~sgGED~kfKvWD~~-G~~Lf~S~~~ey~ITSva~npd~~~~v~S~nt~R~~~------------ 253 (737)
T KOG1524|consen 187 GLVLSLSWSTQSNIIASGGEDFRFKIWDAQ-GANLFTSAAEEYAITSVAFNPEKDYLLWSYNTARFSS------------ 253 (737)
T ss_pred cEEEEeecCccccceeecCCceeEEeeccc-CcccccCChhccceeeeeeccccceeeeeeeeeeecC------------
Confidence 999999999999999999999999999976 4544443 456999999999855555445555211
Q ss_pred cccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 187 GNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 187 ~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
. ..+.|..++|||||..+++|+..|.+-+
T Consensus 254 -p---~~GSifnlsWS~DGTQ~a~gt~~G~v~~ 282 (737)
T KOG1524|consen 254 -P---RVGSIFNLSWSADGTQATCGTSTGQLIV 282 (737)
T ss_pred -C---CccceEEEEEcCCCceeeccccCceEEE
Confidence 1 2236999999999999999999997644
No 175
>KOG1034 consensus Transcriptional repressor EED/ESC/FIE, required for transcriptional silencing, WD repeat superfamily [Transcription]
Probab=99.53 E-value=3.3e-14 Score=121.93 Aligned_cols=154 Identities=12% Similarity=0.196 Sum_probs=121.4
Q ss_pred ceeEEEEcCC----CCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecC-CCEEEEecCCCeEEEEEcCCCee
Q 040274 69 RTDLMRVNPF----NGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPN-GHLMATTGKECKIKIWDLRKYEV 143 (359)
Q Consensus 69 ~v~~l~~sp~----~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~-g~~l~s~~~d~~i~vwd~~~~~~ 143 (359)
....++|+-+ +.++++|+.-|.|+|.|+.++++...+.+|.+.|+.+.++|+ .+++++++.|..|++|++++..+
T Consensus 91 sfytcsw~yd~~~~~p~la~~G~~GvIrVid~~~~~~~~~~~ghG~sINeik~~p~~~qlvls~SkD~svRlwnI~~~~C 170 (385)
T KOG1034|consen 91 SFYTCSWSYDSNTGNPFLAAGGYLGVIRVIDVVSGQCSKNYRGHGGSINEIKFHPDRPQLVLSASKDHSVRLWNIQTDVC 170 (385)
T ss_pred ceEEEEEEecCCCCCeeEEeecceeEEEEEecchhhhccceeccCccchhhhcCCCCCcEEEEecCCceEEEEeccCCeE
Confidence 4555666542 458899999999999999999999999999999999999995 57899999999999999999999
Q ss_pred eEee------cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCC--------------ccc-------cccc---cccCC
Q 040274 144 LQTL------TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGS--------------HNY-------SRYM---GNSMV 191 (359)
Q Consensus 144 ~~~~------~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~--------------~~~-------~~~~---~~~~~ 191 (359)
+..+ .++|.+++|+++| ++++|.|.+|.+|++.... ... ..++ ....
T Consensus 171 v~VfGG~egHrdeVLSvD~~~~gd~i~ScGmDhslk~W~l~~~~f~~~lE~s~~~~~~~t~~pfpt~~~~fp~fst~di- 249 (385)
T KOG1034|consen 171 VAVFGGVEGHRDEVLSVDFSLDGDRIASCGMDHSLKLWRLNVKEFKNKLELSITYSPNKTTRPFPTPKTHFPDFSTTDI- 249 (385)
T ss_pred EEEecccccccCcEEEEEEcCCCCeeeccCCcceEEEEecChhHHhhhhhhhcccCCCCccCcCCcccccccccccccc-
Confidence 9988 3468999999999 8899999999999975210 000 0111 1111
Q ss_pred CCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCC
Q 040274 192 KGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSS 225 (359)
Q Consensus 192 ~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~ 225 (359)
|...|-|+.| .|+++++-+.++.+..|.||--
T Consensus 250 HrnyVDCvrw--~gd~ilSkscenaI~~w~pgkl 281 (385)
T KOG1034|consen 250 HRNYVDCVRW--FGDFILSKSCENAIVCWKPGKL 281 (385)
T ss_pred ccchHHHHHH--HhhheeecccCceEEEEecchh
Confidence 4445667777 5688998888888888888643
No 176
>KOG1538 consensus Uncharacterized conserved protein WDR10, contains WD40 repeats [General function prediction only]
Probab=99.53 E-value=8.5e-14 Score=129.32 Aligned_cols=142 Identities=15% Similarity=0.171 Sum_probs=114.1
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC-CeeeEee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRK-YEVLQTL 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~-~~~~~~~ 147 (359)
.|+.++|-|||..|+.+. +..+.+||++.|..+.++++|.+.|++++|+.||..+++|+.|..|.+|...- |-...+.
T Consensus 14 ci~d~afkPDGsqL~lAA-g~rlliyD~ndG~llqtLKgHKDtVycVAys~dGkrFASG~aDK~VI~W~~klEG~LkYSH 92 (1081)
T KOG1538|consen 14 CINDIAFKPDGTQLILAA-GSRLLVYDTSDGTLLQPLKGHKDTVYCVAYAKDGKRFASGSADKSVIIWTSKLEGILKYSH 92 (1081)
T ss_pred chheeEECCCCceEEEec-CCEEEEEeCCCcccccccccccceEEEEEEccCCceeccCCCceeEEEecccccceeeecc
Confidence 478899999998877764 45789999999999999999999999999999999999999999999998653 3344455
Q ss_pred cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 148 TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 148 ~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
.+.|.|+.|+|-. +++++ =+..-+|.... +.+..+.. ...|.+++|..||.+|+.|..+|+++|
T Consensus 93 ~D~IQCMsFNP~~h~LasCs-LsdFglWS~~q--K~V~K~ks-----s~R~~~CsWtnDGqylalG~~nGTIsi 158 (1081)
T KOG1538|consen 93 NDAIQCMSFNPITHQLASCS-LSDFGLWSPEQ--KSVSKHKS-----SSRIICCSWTNDGQYLALGMFNGTISI 158 (1081)
T ss_pred CCeeeEeecCchHHHhhhcc-hhhccccChhh--hhHHhhhh-----heeEEEeeecCCCcEEEEeccCceEEe
Confidence 7789999999987 55544 34556786322 23333332 237999999999999999999999887
No 177
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=99.52 E-value=2.1e-12 Score=116.04 Aligned_cols=150 Identities=11% Similarity=0.158 Sum_probs=110.0
Q ss_pred ceeEEEEcCCCCEE-EEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEe-cCCCeEEEEEcCCCeeeEe
Q 040274 69 RTDLMRVNPFNGVV-SLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATT-GKECKIKIWDLRKYEVLQT 146 (359)
Q Consensus 69 ~v~~l~~sp~~~~l-~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~-~~d~~i~vwd~~~~~~~~~ 146 (359)
.+.+++|+|++..+ ++++.++.|.+||+.+++.+..+..+.. +..++|+|+++.++++ +.|+.|.+||+.+...+..
T Consensus 32 ~~~~l~~~~dg~~l~~~~~~~~~v~~~d~~~~~~~~~~~~~~~-~~~~~~~~~g~~l~~~~~~~~~l~~~d~~~~~~~~~ 110 (300)
T TIGR03866 32 RPRGITLSKDGKLLYVCASDSDTIQVIDLATGEVIGTLPSGPD-PELFALHPNGKILYIANEDDNLVTVIDIETRKVLAE 110 (300)
T ss_pred CCCceEECCCCCEEEEEECCCCeEEEEECCCCcEEEeccCCCC-ccEEEECCCCCEEEEEcCCCCeEEEEECCCCeEEeE
Confidence 57889999999876 5677889999999999887776665544 5678999999977554 5689999999999888777
Q ss_pred ec--CCceeEEEcCCC--cEEEEcCC-cEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEe-CCCeEEEE
Q 040274 147 LT--GHAKTLDFSQKG--LLAVGTGS-FAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGH-SMGWSGIL 220 (359)
Q Consensus 147 ~~--~~v~~~~~s~~g--l~~~~~d~-~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~-~dg~~~i~ 220 (359)
+. ..+.+++|+|+| +++++.++ .+.+||.... ......... ..+.++.|+|+|.+|++++ .++.+.+|
T Consensus 111 ~~~~~~~~~~~~~~dg~~l~~~~~~~~~~~~~d~~~~-~~~~~~~~~-----~~~~~~~~s~dg~~l~~~~~~~~~v~i~ 184 (300)
T TIGR03866 111 IPVGVEPEGMAVSPDGKIVVNTSETTNMAHFIDTKTY-EIVDNVLVD-----QRPRFAEFTADGKELWVSSEIGGTVSVI 184 (300)
T ss_pred eeCCCCcceEEECCCCCEEEEEecCCCeEEEEeCCCC-eEEEEEEcC-----CCccEEEECCCCCEEEEEcCCCCEEEEE
Confidence 74 346889999999 44444443 5677885443 222222111 1467899999999886554 58888888
Q ss_pred EcCCC
Q 040274 221 VPRSS 225 (359)
Q Consensus 221 ~~gs~ 225 (359)
...++
T Consensus 185 d~~~~ 189 (300)
T TIGR03866 185 DVATR 189 (300)
T ss_pred EcCcc
Confidence 77654
No 178
>KOG0650 consensus WD40 repeat nucleolar protein Bop1, involved in ribosome biogenesis [Translation, ribosomal structure and biogenesis]
Probab=99.52 E-value=1.7e-13 Score=125.91 Aligned_cols=148 Identities=14% Similarity=0.151 Sum_probs=116.4
Q ss_pred ceeEEEEcCCCCEEEEEeCC---CeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeE
Q 040274 69 RTDLMRVNPFNGVVSLGHSG---GTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQ 145 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~d---g~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~ 145 (359)
.|..|.||..|.||++...+ ..|.|+++.......-|.-..+.|.++.|+|...+|+.++. ..|++||+.....+.
T Consensus 523 ~i~~vtWHrkGDYlatV~~~~~~~~VliHQLSK~~sQ~PF~kskG~vq~v~FHPs~p~lfVaTq-~~vRiYdL~kqelvK 601 (733)
T KOG0650|consen 523 SIRQVTWHRKGDYLATVMPDSGNKSVLIHQLSKRKSQSPFRKSKGLVQRVKFHPSKPYLFVATQ-RSVRIYDLSKQELVK 601 (733)
T ss_pred ccceeeeecCCceEEEeccCCCcceEEEEecccccccCchhhcCCceeEEEecCCCceEEEEec-cceEEEehhHHHHHH
Confidence 56677777777777666543 35666666655444445555678999999999888888766 569999999877666
Q ss_pred ee---cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEE
Q 040274 146 TL---TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGIL 220 (359)
Q Consensus 146 ~~---~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~ 220 (359)
.+ ...+.+++++|.| +++++.|+.+..||+..+..++..+..|.. .+++++|++.-.++++|+.||.+.|+
T Consensus 602 kL~tg~kwiS~msihp~GDnli~gs~d~k~~WfDldlsskPyk~lr~H~~----avr~Va~H~ryPLfas~sdDgtv~Vf 677 (733)
T KOG0650|consen 602 KLLTGSKWISSMSIHPNGDNLILGSYDKKMCWFDLDLSSKPYKTLRLHEK----AVRSVAFHKRYPLFASGSDDGTVIVF 677 (733)
T ss_pred HHhcCCeeeeeeeecCCCCeEEEecCCCeeEEEEcccCcchhHHhhhhhh----hhhhhhhccccceeeeecCCCcEEEE
Confidence 65 3468999999988 999999999999998777677777776654 79999999999999999999988775
Q ss_pred E
Q 040274 221 V 221 (359)
Q Consensus 221 ~ 221 (359)
.
T Consensus 678 h 678 (733)
T KOG0650|consen 678 H 678 (733)
T ss_pred e
Confidence 4
No 179
>KOG1408 consensus WD40 repeat protein [Function unknown]
Probab=99.48 E-value=1.1e-12 Score=122.95 Aligned_cols=166 Identities=17% Similarity=0.243 Sum_probs=135.2
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEec---CCCEEEEecCCCeEEEEEcCC-Ceee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHP---NGHLMATTGKECKIKIWDLRK-YEVL 144 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p---~g~~l~s~~~d~~i~vwd~~~-~~~~ 144 (359)
.+.+++.+|++++|++|..-|+++||++........+.+|...|.|+.|+. ..++||+++.|..|.|||+.. ..++
T Consensus 461 G~R~~~vSp~gqhLAsGDr~GnlrVy~Lq~l~~~~~~eAHesEilcLeyS~p~~~~kLLASasrdRlIHV~Dv~rny~l~ 540 (1080)
T KOG1408|consen 461 GFRALAVSPDGQHLASGDRGGNLRVYDLQELEYTCFMEAHESEILCLEYSFPVLTNKLLASASRDRLIHVYDVKRNYDLV 540 (1080)
T ss_pred ceEEEEECCCcceecccCccCceEEEEehhhhhhhheecccceeEEEeecCchhhhHhhhhccCCceEEEEecccccchh
Confidence 799999999999999999999999999998888888999999999999975 356899999999999999732 1111
Q ss_pred Eee----------------------------------------------------cCCceeEEEcCCC--cEEEEcCCcE
Q 040274 145 QTL----------------------------------------------------TGHAKTLDFSQKG--LLAVGTGSFA 170 (359)
Q Consensus 145 ~~~----------------------------------------------------~~~v~~~~~s~~g--l~~~~~d~~i 170 (359)
+++ ...+++++..|+. +++++.|..|
T Consensus 541 qtld~HSssITsvKFa~~gln~~MiscGADksimFr~~qk~~~g~~f~r~t~t~~ktTlYDm~Vdp~~k~v~t~cQDrni 620 (1080)
T KOG1408|consen 541 QTLDGHSSSITSVKFACNGLNRKMISCGADKSIMFRVNQKASSGRLFPRHTQTLSKTTLYDMAVDPTSKLVVTVCQDRNI 620 (1080)
T ss_pred hhhcccccceeEEEEeecCCceEEEeccCchhhheehhccccCceeccccccccccceEEEeeeCCCcceEEEEecccce
Confidence 111 0124667777876 7788899999
Q ss_pred EEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE------------------------------E
Q 040274 171 QILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI------------------------------L 220 (359)
Q Consensus 171 ~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i------------------------------~ 220 (359)
+|||+..+ +....+.+... +.+...-+...|.|-||++.+.|.++.+ +
T Consensus 621 rif~i~sg-Kq~k~FKgs~~-~eG~lIKv~lDPSgiY~atScsdktl~~~Df~sgEcvA~m~GHsE~VTG~kF~nDCkHl 698 (1080)
T KOG1408|consen 621 RIFDIESG-KQVKSFKGSRD-HEGDLIKVILDPSGIYLATSCSDKTLCFVDFVSGECVAQMTGHSEAVTGVKFLNDCKHL 698 (1080)
T ss_pred EEEecccc-ceeeeeccccc-CCCceEEEEECCCccEEEEeecCCceEEEEeccchhhhhhcCcchheeeeeecccchhh
Confidence 99996554 67777766555 5456788899999999999999998876 6
Q ss_pred EcCCCCCceeeeccCC
Q 040274 221 VPRSSEPNFDSWVANP 236 (359)
Q Consensus 221 ~~gs~~~~~~~~~~~~ 236 (359)
++.++|++|.+|.+..
T Consensus 699 ISvsgDgCIFvW~lp~ 714 (1080)
T KOG1408|consen 699 ISVSGDGCIFVWKLPL 714 (1080)
T ss_pred eeecCCceEEEEECch
Confidence 7889999999998754
No 180
>KOG2110 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=99.48 E-value=5.2e-12 Score=110.22 Aligned_cols=108 Identities=23% Similarity=0.354 Sum_probs=91.4
Q ss_pred ceeEEEEcCCCCEEEEEe--CCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCe-EEEEEcCCCeeeE
Q 040274 69 RTDLMRVNPFNGVVSLGH--SGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECK-IKIWDLRKYEVLQ 145 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~--~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~-i~vwd~~~~~~~~ 145 (359)
.+.++++|+.+.+++.=+ ..|.|.|||..+-+++..+.+|.+++.+++|+++|.+|||++..|+ |+||.+.+|+.+.
T Consensus 131 gl~AlS~n~~n~ylAyp~s~t~GdV~l~d~~nl~~v~~I~aH~~~lAalafs~~G~llATASeKGTVIRVf~v~~G~kl~ 210 (391)
T KOG2110|consen 131 GLCALSPNNANCYLAYPGSTTSGDVVLFDTINLQPVNTINAHKGPLAALAFSPDGTLLATASEKGTVIRVFSVPEGQKLY 210 (391)
T ss_pred ceEeeccCCCCceEEecCCCCCceEEEEEcccceeeeEEEecCCceeEEEECCCCCEEEEeccCceEEEEEEcCCccEee
Confidence 455666666677887743 4689999999999999999999999999999999999999999987 7899999999999
Q ss_pred eec-C----CceeEEEcCCC-cE-EEEcCCcEEEEcCC
Q 040274 146 TLT-G----HAKTLDFSQKG-LL-AVGTGSFAQILGDF 176 (359)
Q Consensus 146 ~~~-~----~v~~~~~s~~g-l~-~~~~d~~i~v~d~~ 176 (359)
.|. | .|.+++|+|++ ++ +.|..++|+||.+.
T Consensus 211 eFRRG~~~~~IySL~Fs~ds~~L~~sS~TeTVHiFKL~ 248 (391)
T KOG2110|consen 211 EFRRGTYPVSIYSLSFSPDSQFLAASSNTETVHIFKLE 248 (391)
T ss_pred eeeCCceeeEEEEEEECCCCCeEEEecCCCeEEEEEec
Confidence 993 2 47899999999 55 45556899999864
No 181
>KOG1445 consensus Tumor-specific antigen (contains WD repeats) [Cytoskeleton]
Probab=99.47 E-value=2.1e-13 Score=126.10 Aligned_cols=168 Identities=14% Similarity=0.230 Sum_probs=122.5
Q ss_pred eEEEECC-CCCEEEEecc------------------------------ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCC
Q 040274 52 ILWILPS-SGRYMAVAGR------------------------------RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTS 99 (359)
Q Consensus 52 ~~l~~sp-dg~~l~~~~~------------------------------~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~ 99 (359)
.++.|.| |...|+.+++ .|+++.||| -...|++++.|-+|.+||+.++
T Consensus 631 tDl~WdPFD~~rLAVa~ddg~i~lWr~~a~gl~e~~~tPe~~lt~h~eKI~slRfHPLAadvLa~asyd~Ti~lWDl~~~ 710 (1012)
T KOG1445|consen 631 TDLHWDPFDDERLAVATDDGQINLWRLTANGLPENEMTPEKILTIHGEKITSLRFHPLAADVLAVASYDSTIELWDLANA 710 (1012)
T ss_pred eecccCCCChHHeeecccCceEEEEEeccCCCCcccCCcceeeecccceEEEEEecchhhhHhhhhhccceeeeeehhhh
Confidence 8888888 7788888776 799999999 5678999999999999999999
Q ss_pred cceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCe-eeEeecCCc----eeEEEcCCC--cEEEEcC----C
Q 040274 100 ALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYE-VLQTLTGHA----KTLDFSQKG--LLAVGTG----S 168 (359)
Q Consensus 100 ~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~-~~~~~~~~v----~~~~~s~~g--l~~~~~d----~ 168 (359)
.....+.+|++.|.+++|+|+|+.++|.+.||+|++|..++++ +++.-++++ -.|.|.-+| +++++.| .
T Consensus 711 ~~~~~l~gHtdqIf~~AWSpdGr~~AtVcKDg~~rVy~Prs~e~pv~Eg~gpvgtRgARi~wacdgr~viv~Gfdk~SeR 790 (1012)
T KOG1445|consen 711 KLYSRLVGHTDQIFGIAWSPDGRRIATVCKDGTLRVYEPRSREQPVYEGKGPVGTRGARILWACDGRIVIVVGFDKSSER 790 (1012)
T ss_pred hhhheeccCcCceeEEEECCCCcceeeeecCceEEEeCCCCCCCccccCCCCccCcceeEEEEecCcEEEEecccccchh
Confidence 9888999999999999999999999999999999999999864 565555543 467788888 5566655 5
Q ss_pred cEEEEcCCCCCccccccccccCCCCcceeEEEEccCCC-EEEEEeCCCeEEEEE
Q 040274 169 FAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYED-VLGIGHSMGWSGILV 221 (359)
Q Consensus 169 ~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~-~l~~g~~dg~~~i~~ 221 (359)
.|.+||...-. ...+.....-....+.--.+.+|.. ++++|-.|.++.+|-
T Consensus 791 Qv~~Y~Aq~l~--~~pl~t~~lDvaps~LvP~YD~Ds~~lfltGKGD~~v~~yE 842 (1012)
T KOG1445|consen 791 QVQMYDAQTLD--LRPLYTQVLDVAPSPLVPHYDYDSNVLFLTGKGDRFVNMYE 842 (1012)
T ss_pred hhhhhhhhhcc--CCcceeeeecccCccccccccCCCceEEEecCCCceEEEEE
Confidence 78888843221 0111110000000122234555554 456777788877653
No 182
>PRK01742 tolB translocation protein TolB; Provisional
Probab=99.46 E-value=2.3e-12 Score=122.15 Aligned_cols=162 Identities=12% Similarity=0.122 Sum_probs=109.6
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCCCCEEEEEe-CCCeEEEE--eCCCCcceE
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPFNGVVSLGH-SGGTVTMW--KPTTSALLI 103 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~~~~l~tg~-~dg~v~lw--d~~~~~~~~ 103 (359)
.+..|||||++|++++. ...+++|+|||..|++++ .+|.+.|| |+.++. +.
T Consensus 207 ~~p~wSPDG~~la~~s~~~~~~~i~i~dl~tg~~~~l~~~~g~~~~~~wSPDG~~La~~~~~~g~~~Iy~~d~~~~~-~~ 285 (429)
T PRK01742 207 MSPAWSPDGSKLAYVSFENKKSQLVVHDLRSGARKVVASFRGHNGAPAFSPDGSRLAFASSKDGVLNIYVMGANGGT-PS 285 (429)
T ss_pred ccceEcCCCCEEEEEEecCCCcEEEEEeCCCCceEEEecCCCccCceeECCCCCEEEEEEecCCcEEEEEEECCCCC-eE
Confidence 78899999999987643 345789999999888765 67765555 666554 45
Q ss_pred EeecCCCCeEEEEEecCCCEEEEec-CCCeEEEEEcCCC-eeeEeecCCceeEEEcCCC-cEEEEcCCcEEEEcCCCCCc
Q 040274 104 KMLYHQGPVSALAFHPNGHLMATTG-KECKIKIWDLRKY-EVLQTLTGHAKTLDFSQKG-LLAVGTGSFAQILGDFSGSH 180 (359)
Q Consensus 104 ~~~~h~~~v~~l~~~p~g~~l~s~~-~d~~i~vwd~~~~-~~~~~~~~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~ 180 (359)
.+..+...+.++.|+|||..|+.++ .++...||++... .....+.....++.|+|+| .++......+.+||+..+.
T Consensus 286 ~lt~~~~~~~~~~wSpDG~~i~f~s~~~g~~~I~~~~~~~~~~~~l~~~~~~~~~SpDG~~ia~~~~~~i~~~Dl~~g~- 364 (429)
T PRK01742 286 QLTSGAGNNTEPSWSPDGQSILFTSDRSGSPQVYRMSASGGGASLVGGRGYSAQISADGKTLVMINGDNVVKQDLTSGS- 364 (429)
T ss_pred eeccCCCCcCCEEECCCCCEEEEEECCCCCceEEEEECCCCCeEEecCCCCCccCCCCCCEEEEEcCCCEEEEECCCCC-
Confidence 5666777889999999999776554 5777888876532 1122221111567899999 4433333557779975542
Q ss_pred cccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 181 NYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 181 ~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
.......+ ...++.|+|+|++|++++.+|...+|.
T Consensus 365 ~~~lt~~~------~~~~~~~sPdG~~i~~~s~~g~~~~l~ 399 (429)
T PRK01742 365 TEVLSSTF------LDESPSISPNGIMIIYSSTQGLGKVLQ 399 (429)
T ss_pred eEEecCCC------CCCCceECCCCCEEEEEEcCCCceEEE
Confidence 22111111 245678999999999999888776654
No 183
>KOG0642 consensus Cell-cycle nuclear protein, contains WD-40 repeats [Cell cycle control, cell division, chromosome partitioning]
Probab=99.46 E-value=1.2e-12 Score=119.75 Aligned_cols=151 Identities=19% Similarity=0.251 Sum_probs=113.8
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCC--------CCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPT--------TSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRK 140 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~--------~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~ 140 (359)
.|..+.|+|....|++++.||++.+|++. .-+++.+|.+|.++|.|+++.+++..+++||.||+|+.|++..
T Consensus 296 ~ir~l~~~~sep~lit~sed~~lk~WnLqk~~~s~~~~~epi~tfraH~gPVl~v~v~~n~~~~ysgg~Dg~I~~w~~p~ 375 (577)
T KOG0642|consen 296 CIRALAFHPSEPVLITASEDGTLKLWNLQKAKKSAEKDVEPILTFRAHEGPVLCVVVPSNGEHCYSGGIDGTIRCWNLPP 375 (577)
T ss_pred hhhhhhcCCCCCeEEEeccccchhhhhhcccCCccccceeeeEEEecccCceEEEEecCCceEEEeeccCceeeeeccCC
Confidence 68899999999999999999999999982 1257899999999999999999999999999999999996542
Q ss_pred Ce-------------eeEeecCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCcc------------------------
Q 040274 141 YE-------------VLQTLTGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHN------------------------ 181 (359)
Q Consensus 141 ~~-------------~~~~~~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~------------------------ 181 (359)
.. ++.-+.+.++.+++|+.- +++++.||++++|+.......
T Consensus 376 n~dp~ds~dp~vl~~~l~Ghtdavw~l~~s~~~~~Llscs~DgTvr~w~~~~~~~~~f~~~~e~g~Plsvd~~ss~~a~~ 455 (577)
T KOG0642|consen 376 NQDPDDSYDPSVLSGTLLGHTDAVWLLALSSTKDRLLSCSSDGTVRLWEPTEESPCTFGEPKEHGYPLSVDRTSSRPAHS 455 (577)
T ss_pred CCCcccccCcchhccceeccccceeeeeecccccceeeecCCceEEeeccCCcCccccCCccccCCcceEeeccchhHhh
Confidence 11 111123457889999876 999999999999985432110
Q ss_pred -------------------ccccccccC---CCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 182 -------------------YSRYMGNSM---VKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 182 -------------------~~~~~~~~~---~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
...+..... .....+.-+.++|.+.+.++++.++.+++
T Consensus 456 ~~s~~~~~~~~~~~ev~s~~~~~~s~~~~~~~~~~~in~vVs~~~~~~~~~~hed~~Ir~ 515 (577)
T KOG0642|consen 456 LASFRFGYTSIDDMEVVSDLLIFESSASPGPRRYPQINKVVSHPTADITFTAHEDRSIRF 515 (577)
T ss_pred hhhcccccccchhhhhhhheeeccccCCCcccccCccceEEecCCCCeeEecccCCceec
Confidence 000000000 01124666888999999999999998877
No 184
>KOG1009 consensus Chromatin assembly complex 1 subunit B/CAC2 (contains WD40 repeats) [Chromatin structure and dynamics; Replication, recombination and repair]
Probab=99.45 E-value=4.5e-13 Score=117.96 Aligned_cols=142 Identities=15% Similarity=0.262 Sum_probs=114.1
Q ss_pred ceeEEEEcCCCC-EEEEEeCCCeEEEEeCCCCc---------ceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEc
Q 040274 69 RTDLMRVNPFNG-VVSLGHSGGTVTMWKPTTSA---------LLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDL 138 (359)
Q Consensus 69 ~v~~l~~sp~~~-~l~tg~~dg~v~lwd~~~~~---------~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~ 138 (359)
+|..+.|.+++. .|+||+.|..|++|-+..+. .+..+..|...|+++.|+|+|.+|++|+.+|.|.+|-.
T Consensus 15 pv~s~dfq~n~~~~laT~G~D~~iriW~v~r~~~~~~~~~V~y~s~Ls~H~~aVN~vRf~p~gelLASg~D~g~v~lWk~ 94 (434)
T KOG1009|consen 15 PVYSVDFQKNSLNKLATAGGDKDIRIWKVNRSEPGGGDMKVEYLSSLSRHTRAVNVVRFSPDGELLASGGDGGEVFLWKQ 94 (434)
T ss_pred ceEEEEeccCcccceecccCccceeeeeeeecCCCCCceeEEEeecccCCcceeEEEEEcCCcCeeeecCCCceEEEEEe
Confidence 788899998655 99999999999999876432 23456689999999999999999999999999999965
Q ss_pred C--------C--------CeeeEeec---CCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCccee
Q 040274 139 R--------K--------YEVLQTLT---GHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIG 197 (359)
Q Consensus 139 ~--------~--------~~~~~~~~---~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~ 197 (359)
. + ......+. ..+..++|+|++ +++++.|+.+++||+..+ ........|.. -|.
T Consensus 95 ~~~~~~~~d~e~~~~ke~w~v~k~lr~h~~diydL~Ws~d~~~l~s~s~dns~~l~Dv~~G-~l~~~~~dh~~----yvq 169 (434)
T KOG1009|consen 95 GDVRIFDADTEADLNKEKWVVKKVLRGHRDDIYDLAWSPDSNFLVSGSVDNSVRLWDVHAG-QLLAILDDHEH----YVQ 169 (434)
T ss_pred cCcCCccccchhhhCccceEEEEEecccccchhhhhccCCCceeeeeeccceEEEEEeccc-eeEeecccccc----ccc
Confidence 4 2 11122223 448999999999 788889999999997655 55666666644 799
Q ss_pred EEEEccCCCEEEEEeCCC
Q 040274 198 KVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 198 ~~~~sp~~~~l~~g~~dg 215 (359)
.++|.|-++++++-+.|.
T Consensus 170 gvawDpl~qyv~s~s~dr 187 (434)
T KOG1009|consen 170 GVAWDPLNQYVASKSSDR 187 (434)
T ss_pred eeecchhhhhhhhhccCc
Confidence 999999999999888876
No 185
>KOG0644 consensus Uncharacterized conserved protein, contains WD40 repeat and BROMO domains [General function prediction only]
Probab=99.45 E-value=2.6e-13 Score=128.93 Aligned_cols=175 Identities=19% Similarity=0.342 Sum_probs=133.5
Q ss_pred Hhhhhccc----eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeC
Q 040274 44 KVEKNLVH----ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKP 96 (359)
Q Consensus 44 ~~e~ll~~----~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~ 96 (359)
..-.|+-+ ||..|...|+++++|++ .|+.++.+..+.+++++|.|..|++|.+
T Consensus 182 ~ikrLlgH~naVyca~fDrtg~~Iitgsdd~lvKiwS~et~~~lAs~rGhs~ditdlavs~~n~~iaaaS~D~vIrvWrl 261 (1113)
T KOG0644|consen 182 NIKRLLGHRNAVYCAIFDRTGRYIITGSDDRLVKIWSMETARCLASCRGHSGDITDLAVSSNNTMIAAASNDKVIRVWRL 261 (1113)
T ss_pred HHHHHHhhhhheeeeeeccccceEeecCccceeeeeeccchhhhccCCCCccccchhccchhhhhhhhcccCceEEEEec
Confidence 33444554 99999999999999998 7899999999999999999999999999
Q ss_pred CCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC--------------CeeeEe----------------
Q 040274 97 TTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRK--------------YEVLQT---------------- 146 (359)
Q Consensus 97 ~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~--------------~~~~~~---------------- 146 (359)
.++.++..+.+|++.|++++|+|-. +.+.||++++||.+- +..+..
T Consensus 262 ~~~~pvsvLrghtgavtaiafsP~~----sss~dgt~~~wd~r~~~~~y~prp~~~~~~~~~~s~~~~~~~~~f~Tgs~d 337 (1113)
T KOG0644|consen 262 PDGAPVSVLRGHTGAVTAIAFSPRA----SSSDDGTCRIWDARLEPRIYVPRPLKFTEKDLVDSILFENNGDRFLTGSRD 337 (1113)
T ss_pred CCCchHHHHhccccceeeeccCccc----cCCCCCceEeccccccccccCCCCCCcccccceeeeeccccccccccccCC
Confidence 9999999999999999999999953 778899999998650 000000
Q ss_pred -----------------------------------------------------e---cCCceeEEEcCCC---cEEEEcC
Q 040274 147 -----------------------------------------------------L---TGHAKTLDFSQKG---LLAVGTG 167 (359)
Q Consensus 147 -----------------------------------------------------~---~~~v~~~~~s~~g---l~~~~~d 167 (359)
+ ...+..+.++|-. ..+++.|
T Consensus 338 ~ea~n~e~~~l~~~~~~lif~t~ssd~~~~~~~ar~~~~~~vwnl~~g~l~H~l~ghsd~~yvLd~Hpfn~ri~msag~d 417 (1113)
T KOG0644|consen 338 GEARNHEFEQLAWRSNLLIFVTRSSDLSSIVVTARNDHRLCVWNLYTGQLLHNLMGHSDEVYVLDVHPFNPRIAMSAGYD 417 (1113)
T ss_pred cccccchhhHhhhhccceEEEeccccccccceeeeeeeEeeeeecccchhhhhhcccccceeeeeecCCCcHhhhhccCC
Confidence 0 0012345555654 5667788
Q ss_pred CcEEEEcCCCCCccccccc-cccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCCCc
Q 040274 168 SFAQILGDFSGSHNYSRYM-GNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSEPN 228 (359)
Q Consensus 168 ~~i~v~d~~~~~~~~~~~~-~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~~~ 228 (359)
|...|||+..+ .....|. +| +.+....||++|..++....-|.+.|+-.|.++..
T Consensus 418 gst~iwdi~eg-~pik~y~~gh-----~kl~d~kFSqdgts~~lsd~hgql~i~g~gqs~s~ 473 (1113)
T KOG0644|consen 418 GSTIIWDIWEG-IPIKHYFIGH-----GKLVDGKFSQDGTSIALSDDHGQLYILGTGQSKSQ 473 (1113)
T ss_pred CceEeeecccC-Ccceeeeccc-----ceeeccccCCCCceEecCCCCCceEEeccCCCccc
Confidence 99999996555 3444333 33 25788899999999999988898888877776544
No 186
>KOG0650 consensus WD40 repeat nucleolar protein Bop1, involved in ribosome biogenesis [Translation, ribosomal structure and biogenesis]
Probab=99.44 E-value=1.1e-12 Score=120.75 Aligned_cols=168 Identities=15% Similarity=0.207 Sum_probs=132.2
Q ss_pred eEEEECCCCCEEEEecc--------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEe
Q 040274 52 ILWILPSSGRYMAVAGR--------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKM 105 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~--------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~ 105 (359)
..+.||..|.||++... .|.++.|+|...+|++++. ..|+|||+.....+..+
T Consensus 525 ~~vtWHrkGDYlatV~~~~~~~~VliHQLSK~~sQ~PF~kskG~vq~v~FHPs~p~lfVaTq-~~vRiYdL~kqelvKkL 603 (733)
T KOG0650|consen 525 RQVTWHRKGDYLATVMPDSGNKSVLIHQLSKRKSQSPFRKSKGLVQRVKFHPSKPYLFVATQ-RSVRIYDLSKQELVKKL 603 (733)
T ss_pred ceeeeecCCceEEEeccCCCcceEEEEecccccccCchhhcCCceeEEEecCCCceEEEEec-cceEEEehhHHHHHHHH
Confidence 88999999999997543 7899999998888888765 58999999988777777
Q ss_pred ecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCC-eeeEee---cCCceeEEEcCCC-cE-EEEcCCcEEEEcCC---
Q 040274 106 LYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKY-EVLQTL---TGHAKTLDFSQKG-LL-AVGTGSFAQILGDF--- 176 (359)
Q Consensus 106 ~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~-~~~~~~---~~~v~~~~~s~~g-l~-~~~~d~~i~v~d~~--- 176 (359)
......|.+++.+|.|..|+.++.|+.+..||+.-+ ++.+++ ...+++++|++.- |+ +++.||++.||.-.
T Consensus 604 ~tg~kwiS~msihp~GDnli~gs~d~k~~WfDldlsskPyk~lr~H~~avr~Va~H~ryPLfas~sdDgtv~Vfhg~VY~ 683 (733)
T KOG0650|consen 604 LTGSKWISSMSIHPNGDNLILGSYDKKMCWFDLDLSSKPYKTLRLHEKAVRSVAFHKRYPLFASGSDDGTVIVFHGMVYN 683 (733)
T ss_pred hcCCeeeeeeeecCCCCeEEEecCCCeeEEEEcccCcchhHHhhhhhhhhhhhhhccccceeeeecCCCcEEEEeeeeeh
Confidence 777788999999999999999999999999999854 344444 4558999999988 54 55556998887511
Q ss_pred ---CCC--ccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEE
Q 040274 177 ---SGS--HNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGIL 220 (359)
Q Consensus 177 ---~~~--~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~ 220 (359)
.+. -++..+.+|.......|..+.|+|...||++++.||.+++|
T Consensus 684 Dl~qnpliVPlK~L~gH~~~~~~gVLd~~wHP~qpWLfsAGAd~tirlf 732 (733)
T KOG0650|consen 684 DLLQNPLIVPLKRLRGHEKTNDLGVLDTIWHPRQPWLFSAGADGTIRLF 732 (733)
T ss_pred hhhcCCceEeeeeccCceeecccceEeecccCCCceEEecCCCceEEee
Confidence 111 11234456644233458899999999999999999998886
No 187
>KOG4497 consensus Uncharacterized conserved protein WDR8, contains WD repeats [General function prediction only]
Probab=99.44 E-value=5.2e-12 Score=108.69 Aligned_cols=162 Identities=16% Similarity=0.277 Sum_probs=117.5
Q ss_pred EEEECCCCCEEEEecc---------------------ceeEEEEcCCCCEEEE-EeCCCeEEEEeCCCCcceEEeecCCC
Q 040274 53 LWILPSSGRYMAVAGR---------------------RTDLMRVNPFNGVVSL-GHSGGTVTMWKPTTSALLIKMLYHQG 110 (359)
Q Consensus 53 ~l~~spdg~~l~~~~~---------------------~v~~l~~sp~~~~l~t-g~~dg~v~lwd~~~~~~~~~~~~h~~ 110 (359)
-.+|||+|+|+|++++ .|.-+.|..|.-++++ ...|+.|.+|++...+--..+.....
T Consensus 13 ~c~fSp~g~yiAs~~~yrlviRd~~tlq~~qlf~cldki~yieW~ads~~ilC~~yk~~~vqvwsl~Qpew~ckIdeg~a 92 (447)
T KOG4497|consen 13 FCSFSPCGNYIASLSRYRLVIRDSETLQLHQLFLCLDKIVYIEWKADSCHILCVAYKDPKVQVWSLVQPEWYCKIDEGQA 92 (447)
T ss_pred ceeECCCCCeeeeeeeeEEEEeccchhhHHHHHHHHHHhhheeeeccceeeeeeeeccceEEEEEeecceeEEEeccCCC
Confidence 3579999999999987 7888999988776555 46788999999998888888888888
Q ss_pred CeEEEEEecCCCE-EEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCC-cEEEEc--C-----------------
Q 040274 111 PVSALAFHPNGHL-MATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG-LLAVGT--G----------------- 167 (359)
Q Consensus 111 ~v~~l~~~p~g~~-l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g-l~~~~~--d----------------- 167 (359)
++.+++|||||+. |.++.-|-.|.||.+.+.+....- ...+..++|+||| +.+... |
T Consensus 93 gls~~~WSPdgrhiL~tseF~lriTVWSL~t~~~~~~~~pK~~~kg~~f~~dg~f~ai~sRrDCkdyv~i~~c~~W~ll~ 172 (447)
T KOG4497|consen 93 GLSSISWSPDGRHILLTSEFDLRITVWSLNTQKGYLLPHPKTNVKGYAFHPDGQFCAILSRRDCKDYVQISSCKAWILLK 172 (447)
T ss_pred cceeeeECCCcceEeeeecceeEEEEEEeccceeEEecccccCceeEEECCCCceeeeeecccHHHHHHHHhhHHHHHHH
Confidence 9999999999965 556667889999999876553322 3445777888887 333221 1
Q ss_pred ------------------CcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEE
Q 040274 168 ------------------SFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGIL 220 (359)
Q Consensus 168 ------------------~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~ 220 (359)
+.+-|||..-. -.+..|.. +-.+-.+.|+|.+++|++|+.|+.++|+
T Consensus 173 ~f~~dT~DltgieWsPdg~~laVwd~~Le-ykv~aYe~-----~lG~k~v~wsP~~qflavGsyD~~lrvl 237 (447)
T KOG4497|consen 173 EFKLDTIDLTGIEWSPDGNWLAVWDNVLE-YKVYAYER-----GLGLKFVEWSPCNQFLAVGSYDQMLRVL 237 (447)
T ss_pred hcCCCcccccCceECCCCcEEEEecchhh-heeeeeee-----ccceeEEEeccccceEEeeccchhhhhh
Confidence 12445552111 11112221 1258889999999999999999988874
No 188
>KOG4227 consensus WD40 repeat protein [General function prediction only]
Probab=99.42 E-value=4.9e-12 Score=111.06 Aligned_cols=184 Identities=13% Similarity=0.101 Sum_probs=135.4
Q ss_pred eEEEECCCCCEEEEecc------------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcc
Q 040274 52 ILWILPSSGRYMAVAGR------------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSAL 101 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~ 101 (359)
..|.||.+|++|++||. .|.|++|+..+.++++|..+|+|.+.|+.+.+.
T Consensus 60 NAlqFS~N~~~L~SGGDD~~~~~W~~de~~~~k~~KPI~~~~~~H~SNIF~L~F~~~N~~~~SG~~~~~VI~HDiEt~qs 139 (609)
T KOG4227|consen 60 NALQFSHNDRFLASGGDDMHGRVWNVDELMVRKTPKPIGVMEHPHRSNIFSLEFDLENRFLYSGERWGTVIKHDIETKQS 139 (609)
T ss_pred ceeeeccCCeEEeecCCcceeeeechHHHHhhcCCCCceeccCccccceEEEEEccCCeeEecCCCcceeEeeeccccee
Confidence 78999999999999998 799999999999999999999999999999988
Q ss_pred eEEeec--CCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCe-ee-----EeecCCceeEEEcCCC---cEEEEcCCcE
Q 040274 102 LIKMLY--HQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYE-VL-----QTLTGHAKTLDFSQKG---LLAVGTGSFA 170 (359)
Q Consensus 102 ~~~~~~--h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~-~~-----~~~~~~v~~~~~s~~g---l~~~~~d~~i 170 (359)
+..+.. ..+.|+.+..+|..+.|++.+.++.|.+||++... ++ ..+.....++.|+|-. +++.+..+.+
T Consensus 140 i~V~~~~~~~~~VY~m~~~P~DN~~~~~t~~~~V~~~D~Rd~~~~~~~~~~AN~~~~F~t~~F~P~~P~Li~~~~~~~G~ 219 (609)
T KOG4227|consen 140 IYVANENNNRGDVYHMDQHPTDNTLIVVTRAKLVSFIDNRDRQNPISLVLPANSGKNFYTAEFHPETPALILVNSETGGP 219 (609)
T ss_pred eeeecccCcccceeecccCCCCceEEEEecCceEEEEeccCCCCCCceeeecCCCccceeeeecCCCceeEEeccccCCC
Confidence 877642 23599999999999999999999999999998644 22 2224456889999987 5556667889
Q ss_pred EEEcCCCCCccccccccccCCC--CcceeEEEEccCCCEEEEEe-------------------C----CCeEEE------
Q 040274 171 QILGDFSGSHNYSRYMGNSMVK--GYQIGKVSFRPYEDVLGIGH-------------------S----MGWSGI------ 219 (359)
Q Consensus 171 ~v~d~~~~~~~~~~~~~~~~~~--~~~v~~~~~sp~~~~l~~g~-------------------~----dg~~~i------ 219 (359)
.+||.+.....+..+....+.+ ...-+++.|+|.|..|++-- . +|+..+
T Consensus 220 ~~~D~R~~~~~~~~~~~~~~L~~~~~~~M~~~~~~~G~Q~msiRR~~~P~~~D~~S~R~~V~k~D~N~~GY~N~~T~KS~ 299 (609)
T KOG4227|consen 220 NVFDRRMQARPVYQRSMFKGLPQENTEWMGSLWSPSGNQFMSIRRGKCPLYFDFISQRCFVLKSDHNPNGYCNIKTIKSM 299 (609)
T ss_pred CceeeccccchHHhhhccccCcccchhhhheeeCCCCCeehhhhccCCCEEeeeecccceeEeccCCCCcceeeeeeeee
Confidence 9999765443333322221101 11235667777776544211 1 122211
Q ss_pred -------EEcCCCCCceeeeccC
Q 040274 220 -------LVPRSSEPNFDSWVAN 235 (359)
Q Consensus 220 -------~~~gs~~~~~~~~~~~ 235 (359)
+.+|+.+-++.+|.+.
T Consensus 300 ~F~~D~~v~tGSD~~~i~~WklP 322 (609)
T KOG4227|consen 300 TFIDDYTVATGSDHWGIHIWKLP 322 (609)
T ss_pred eeecceeeeccCcccceEEEecC
Confidence 6889999999999864
No 189
>KOG2139 consensus WD40 repeat protein [General function prediction only]
Probab=99.42 E-value=1.4e-11 Score=107.31 Aligned_cols=144 Identities=15% Similarity=0.252 Sum_probs=102.0
Q ss_pred ceeEEEEcCCCCEEEEEeC-CCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC-CeeeE-
Q 040274 69 RTDLMRVNPFNGVVSLGHS-GGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRK-YEVLQ- 145 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~-dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~-~~~~~- 145 (359)
.|++|.|++||..+++++. |..|.|||++++..+....-..+.++-+.|||||.+|++++-|+..++|+... .....
T Consensus 197 pVtsmqwn~dgt~l~tAS~gsssi~iWdpdtg~~~pL~~~glgg~slLkwSPdgd~lfaAt~davfrlw~e~q~wt~erw 276 (445)
T KOG2139|consen 197 PVTSMQWNEDGTILVTASFGSSSIMIWDPDTGQKIPLIPKGLGGFSLLKWSPDGDVLFAATCDAVFRLWQENQSWTKERW 276 (445)
T ss_pred eeeEEEEcCCCCEEeecccCcceEEEEcCCCCCcccccccCCCceeeEEEcCCCCEEEEecccceeeeehhcccceecce
Confidence 8999999999999999885 57899999999877655544467789999999999999999999999995543 32222
Q ss_pred ee-cCCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccc--------------------cccccccCCCCcceeEEEE
Q 040274 146 TL-TGHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNY--------------------SRYMGNSMVKGYQIGKVSF 201 (359)
Q Consensus 146 ~~-~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~--------------------~~~~~~~~~~~~~v~~~~~ 201 (359)
.+ .+.|...+|+|.| +++++.. -.+|.+...++.. ....+... -+..+.+++|
T Consensus 277 ~lgsgrvqtacWspcGsfLLf~~sgs--p~lysl~f~~~~~~~~~~~~~k~~lliaDL~e~ti~ag~~l-~cgeaq~law 353 (445)
T KOG2139|consen 277 ILGSGRVQTACWSPCGSFLLFACSGS--PRLYSLTFDGEDSVFLRPQSIKRVLLIADLQEVTICAGQRL-CCGEAQCLAW 353 (445)
T ss_pred eccCCceeeeeecCCCCEEEEEEcCC--ceEEEEeecCCCccccCcccceeeeeeccchhhhhhcCccc-ccCccceeeE
Confidence 22 6789999999999 3344333 3344332211110 00111111 2456889999
Q ss_pred ccCCCEEEEEeCCC
Q 040274 202 RPYEDVLGIGHSMG 215 (359)
Q Consensus 202 sp~~~~l~~g~~dg 215 (359)
.|.|.+|++....+
T Consensus 354 DpsGeyLav~fKg~ 367 (445)
T KOG2139|consen 354 DPSGEYLAVIFKGQ 367 (445)
T ss_pred CCCCCEEEEEEcCC
Confidence 99999999876554
No 190
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=99.42 E-value=2.1e-11 Score=111.68 Aligned_cols=169 Identities=15% Similarity=0.211 Sum_probs=113.2
Q ss_pred eEEEECCCCCEEEEecc---------------------------ceeEEEEcCCCCEEEEEe-CCCeEEEEeCCCCcceE
Q 040274 52 ILWILPSSGRYMAVAGR---------------------------RTDLMRVNPFNGVVSLGH-SGGTVTMWKPTTSALLI 103 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~---------------------------~v~~l~~sp~~~~l~tg~-~dg~v~lwd~~~~~~~~ 103 (359)
..+.++|+|++|++++. .+.+++++|+++++++++ .++.|.+||+.+...+.
T Consensus 83 ~~i~~~~~g~~l~v~~~~~~~v~v~~~~~~g~~~~~~~~~~~~~~~~~~~~~p~g~~l~v~~~~~~~v~v~d~~~~g~l~ 162 (330)
T PRK11028 83 THISTDHQGRFLFSASYNANCVSVSPLDKDGIPVAPIQIIEGLEGCHSANIDPDNRTLWVPCLKEDRIRLFTLSDDGHLV 162 (330)
T ss_pred eEEEECCCCCEEEEEEcCCCeEEEEEECCCCCCCCceeeccCCCcccEeEeCCCCCEEEEeeCCCCEEEEEEECCCCccc
Confidence 67889999998887653 346778999998886555 56899999997632221
Q ss_pred -------EeecCCCCeEEEEEecCCCEEEEecC-CCeEEEEEcCC--C--eeeEeec---C------CceeEEEcCCC--
Q 040274 104 -------KMLYHQGPVSALAFHPNGHLMATTGK-ECKIKIWDLRK--Y--EVLQTLT---G------HAKTLDFSQKG-- 160 (359)
Q Consensus 104 -------~~~~h~~~v~~l~~~p~g~~l~s~~~-d~~i~vwd~~~--~--~~~~~~~---~------~v~~~~~s~~g-- 160 (359)
.... ......+.|+|+|+++++++. ++.|.+||+.. + +.+..+. . ....+.++|+|
T Consensus 163 ~~~~~~~~~~~-g~~p~~~~~~pdg~~lyv~~~~~~~v~v~~~~~~~~~~~~~~~~~~~p~~~~~~~~~~~i~~~pdg~~ 241 (330)
T PRK11028 163 AQEPAEVTTVE-GAGPRHMVFHPNQQYAYCVNELNSSVDVWQLKDPHGEIECVQTLDMMPADFSDTRWAADIHITPDGRH 241 (330)
T ss_pred ccCCCceecCC-CCCCceEEECCCCCEEEEEecCCCEEEEEEEeCCCCCEEEEEEEecCCCcCCCCccceeEEECCCCCE
Confidence 1112 234578999999999988776 89999999973 2 2333331 1 12358899999
Q ss_pred cEEEE-cCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeC-CCeEEEEEcC
Q 040274 161 LLAVG-TGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHS-MGWSGILVPR 223 (359)
Q Consensus 161 l~~~~-~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~-dg~~~i~~~g 223 (359)
++++. .++.|.+|++....... .+..+.. .+.....+.|+|+|++|++++. ++.+.+|...
T Consensus 242 lyv~~~~~~~I~v~~i~~~~~~~-~~~~~~~-~~~~p~~~~~~~dg~~l~va~~~~~~v~v~~~~ 304 (330)
T PRK11028 242 LYACDRTASLISVFSVSEDGSVL-SFEGHQP-TETQPRGFNIDHSGKYLIAAGQKSHHISVYEID 304 (330)
T ss_pred EEEecCCCCeEEEEEEeCCCCeE-EEeEEEe-ccccCCceEECCCCCEEEEEEccCCcEEEEEEc
Confidence 44433 36899999975432222 1222211 1124567899999999998775 6777776543
No 191
>KOG1538 consensus Uncharacterized conserved protein WDR10, contains WD40 repeats [General function prediction only]
Probab=99.41 E-value=1.2e-11 Score=115.27 Aligned_cols=145 Identities=14% Similarity=0.180 Sum_probs=110.1
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee---cCCCCeEEEEEecCC-----CEEEEecCCCeEEEEEcCC
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML---YHQGPVSALAFHPNG-----HLMATTGKECKIKIWDLRK 140 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~---~h~~~v~~l~~~p~g-----~~l~s~~~d~~i~vwd~~~ 140 (359)
.|.+++|..||++++.|..||+|.+-+-. +++...+. +..++|++++|+|+. ..+++.....++.+|.+.
T Consensus 134 R~~~CsWtnDGqylalG~~nGTIsiRNk~-gEek~~I~Rpgg~Nspiwsi~~~p~sg~G~~di~aV~DW~qTLSFy~Ls- 211 (1081)
T KOG1538|consen 134 RIICCSWTNDGQYLALGMFNGTISIRNKN-GEEKVKIERPGGSNSPIWSICWNPSSGEGRNDILAVADWGQTLSFYQLS- 211 (1081)
T ss_pred eEEEeeecCCCcEEEEeccCceEEeecCC-CCcceEEeCCCCCCCCceEEEecCCCCCCccceEEEEeccceeEEEEec-
Confidence 79999999999999999999999998644 44444443 467899999999953 357777777888888765
Q ss_pred CeeeE---eecCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 141 YEVLQ---TLTGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 141 ~~~~~---~~~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
|+.+- .+.-...|+.+.++| ++.||.|+.+.+|- +.+ -...++... ...|+++...|++++++.|+.||
T Consensus 212 G~~Igk~r~L~FdP~CisYf~NGEy~LiGGsdk~L~~fT-R~G-vrLGTvg~~----D~WIWtV~~~PNsQ~v~~GCqDG 285 (1081)
T KOG1538|consen 212 GKQIGKDRALNFDPCCISYFTNGEYILLGGSDKQLSLFT-RDG-VRLGTVGEQ----DSWIWTVQAKPNSQYVVVGCQDG 285 (1081)
T ss_pred ceeecccccCCCCchhheeccCCcEEEEccCCCceEEEe-ecC-eEEeecccc----ceeEEEEEEccCCceEEEEEccC
Confidence 33332 223346789999999 78899999999995 444 233333332 23899999999999999999999
Q ss_pred eEEEEE
Q 040274 216 WSGILV 221 (359)
Q Consensus 216 ~~~i~~ 221 (359)
++..|.
T Consensus 286 TiACyN 291 (1081)
T KOG1538|consen 286 TIACYN 291 (1081)
T ss_pred eeehhh
Confidence 886653
No 192
>KOG1188 consensus WD40 repeat protein [General function prediction only]
Probab=99.40 E-value=2.5e-11 Score=105.00 Aligned_cols=167 Identities=17% Similarity=0.240 Sum_probs=114.6
Q ss_pred ceeEEEEcC--CCCEEEEEeCCCeEEEEeCCCCcceE--EeecCC-CCeEEEEEecCCCEEEEecC----CCeEEEEEcC
Q 040274 69 RTDLMRVNP--FNGVVSLGHSGGTVTMWKPTTSALLI--KMLYHQ-GPVSALAFHPNGHLMATTGK----ECKIKIWDLR 139 (359)
Q Consensus 69 ~v~~l~~sp--~~~~l~tg~~dg~v~lwd~~~~~~~~--~~~~h~-~~v~~l~~~p~g~~l~s~~~----d~~i~vwd~~ 139 (359)
.++.+.|.. ....+.+|+.||+|++||+++..... .+..|. .+..+++.+..++.+++|+. |-.|.+||+|
T Consensus 72 ~~N~vrf~~~ds~h~v~s~ssDG~Vr~wD~Rs~~e~a~~~~~~~~~~~f~~ld~nck~~ii~~GtE~~~s~A~v~lwDvR 151 (376)
T KOG1188|consen 72 TTNGVRFISCDSPHGVISCSSDGTVRLWDIRSQAESARISWTQQSGTPFICLDLNCKKNIIACGTELTRSDASVVLWDVR 151 (376)
T ss_pred cccceEEecCCCCCeeEEeccCCeEEEEEeecchhhhheeccCCCCCcceEeeccCcCCeEEeccccccCceEEEEEEec
Confidence 678888866 45679999999999999999765433 344555 46778887778888888764 6679999999
Q ss_pred CCee-eEee----cCCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCC-CEEEE
Q 040274 140 KYEV-LQTL----TGHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYE-DVLGI 210 (359)
Q Consensus 140 ~~~~-~~~~----~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~-~~l~~ 210 (359)
..+. +..+ .+.|++++|+|.. +++++.||-|.|||+..... -..+..- ..+++.|.++.|+..+ +.|.+
T Consensus 152 ~~qq~l~~~~eSH~DDVT~lrFHP~~pnlLlSGSvDGLvnlfD~~~d~E-eDaL~~v-iN~~sSI~~igw~~~~ykrI~c 229 (376)
T KOG1188|consen 152 SEQQLLRQLNESHNDDVTQLRFHPSDPNLLLSGSVDGLVNLFDTKKDNE-EDALLHV-INHGSSIHLIGWLSKKYKRIMC 229 (376)
T ss_pred cccchhhhhhhhccCcceeEEecCCCCCeEEeecccceEEeeecCCCcc-hhhHHHh-hcccceeeeeeeecCCcceEEE
Confidence 8654 6555 4559999999987 88999999999999754422 2222111 1145579999999887 33555
Q ss_pred EeCCCeEEEEEcCCCCCceeeeccCCCCC
Q 040274 211 GHSMGWSGILVPRSSEPNFDSWVANPFET 239 (359)
Q Consensus 211 g~~dg~~~i~~~gs~~~~~~~~~~~~~~~ 239 (359)
-+......+|.-..++ -.+|.-+|...
T Consensus 230 lTH~Etf~~~ele~~~--~~~~~~~~~~~ 256 (376)
T KOG1188|consen 230 LTHMETFAIYELEDGS--EETWLENPDVS 256 (376)
T ss_pred EEccCceeEEEccCCC--hhhcccCccch
Confidence 5555545555443333 33444444333
No 193
>PRK03629 tolB translocation protein TolB; Provisional
Probab=99.40 E-value=3.3e-11 Score=114.12 Aligned_cols=157 Identities=10% Similarity=0.104 Sum_probs=107.3
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCCCCEEEEE-eCCC--eEEEEeCCCCcceE
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPFNGVVSLG-HSGG--TVTMWKPTTSALLI 103 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~~~~l~tg-~~dg--~v~lwd~~~~~~~~ 103 (359)
.+..|||||+.|++.+. .+..+.|+|||..|+.. +.+| .|++||+.++...
T Consensus 202 ~~p~wSPDG~~la~~s~~~g~~~i~i~dl~~G~~~~l~~~~~~~~~~~~SPDG~~La~~~~~~g~~~I~~~d~~tg~~~- 280 (429)
T PRK03629 202 MSPAWSPDGSKLAYVTFESGRSALVIQTLANGAVRQVASFPRHNGAPAFSPDGSKLAFALSKTGSLNLYVMDLASGQIR- 280 (429)
T ss_pred eeeEEcCCCCEEEEEEecCCCcEEEEEECCCCCeEEccCCCCCcCCeEECCCCCEEEEEEcCCCCcEEEEEECCCCCEE-
Confidence 68999999999986432 35568999999988765 4444 5889999887654
Q ss_pred EeecCCCCeEEEEEecCCCEEEEecCC-C--eEEEEEcCCCeeeEe-e-cCCceeEEEcCCC--cEEEEcC---CcEEEE
Q 040274 104 KMLYHQGPVSALAFHPNGHLMATTGKE-C--KIKIWDLRKYEVLQT-L-TGHAKTLDFSQKG--LLAVGTG---SFAQIL 173 (359)
Q Consensus 104 ~~~~h~~~v~~l~~~p~g~~l~s~~~d-~--~i~vwd~~~~~~~~~-~-~~~v~~~~~s~~g--l~~~~~d---~~i~v~ 173 (359)
.+..+...+..+.|+|||+.|+.++.+ + .|+++|+.++..... . .....++.|+|+| ++.++.+ ..|.+|
T Consensus 281 ~lt~~~~~~~~~~wSPDG~~I~f~s~~~g~~~Iy~~d~~~g~~~~lt~~~~~~~~~~~SpDG~~Ia~~~~~~g~~~I~~~ 360 (429)
T PRK03629 281 QVTDGRSNNTEPTWFPDSQNLAYTSDQAGRPQVYKVNINGGAPQRITWEGSQNQDADVSSDGKFMVMVSSNGGQQHIAKQ 360 (429)
T ss_pred EccCCCCCcCceEECCCCCEEEEEeCCCCCceEEEEECCCCCeEEeecCCCCccCEEECCCCCEEEEEEccCCCceEEEE
Confidence 344445567899999999988776654 3 466667776654222 2 2345679999999 4444432 358888
Q ss_pred cCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCe
Q 040274 174 GDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGW 216 (359)
Q Consensus 174 d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~ 216 (359)
|+..+. ...+... . ...+..|+|||.+|+.++.++.
T Consensus 361 dl~~g~--~~~Lt~~-~----~~~~p~~SpDG~~i~~~s~~~~ 396 (429)
T PRK03629 361 DLATGG--VQVLTDT-F----LDETPSIAPNGTMVIYSSSQGM 396 (429)
T ss_pred ECCCCC--eEEeCCC-C----CCCCceECCCCCEEEEEEcCCC
Confidence 865442 2222211 1 2456789999999999888764
No 194
>KOG0642 consensus Cell-cycle nuclear protein, contains WD-40 repeats [Cell cycle control, cell division, chromosome partitioning]
Probab=99.39 E-value=7.4e-12 Score=114.63 Aligned_cols=147 Identities=13% Similarity=0.157 Sum_probs=111.7
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCC------CC----cceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEc
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPT------TS----ALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDL 138 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~------~~----~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~ 138 (359)
+|.|+++.+.+..+++|+.||+|+.|++. .. .....+.||++.|+.+++|+....|++|+.||++++|+.
T Consensus 346 PVl~v~v~~n~~~~ysgg~Dg~I~~w~~p~n~dp~ds~dp~vl~~~l~Ghtdavw~l~~s~~~~~Llscs~DgTvr~w~~ 425 (577)
T KOG0642|consen 346 PVLCVVVPSNGEHCYSGGIDGTIRCWNLPPNQDPDDSYDPSVLSGTLLGHTDAVWLLALSSTKDRLLSCSSDGTVRLWEP 425 (577)
T ss_pred ceEEEEecCCceEEEeeccCceeeeeccCCCCCcccccCcchhccceeccccceeeeeecccccceeeecCCceEEeecc
Confidence 89999999999999999999999999543 21 223457799999999999999889999999999999986
Q ss_pred CCCeeeEee---------------------------------------------c----------CCceeEEEcCCC--c
Q 040274 139 RKYEVLQTL---------------------------------------------T----------GHAKTLDFSQKG--L 161 (359)
Q Consensus 139 ~~~~~~~~~---------------------------------------------~----------~~v~~~~~s~~g--l 161 (359)
....+ .+| . ..+.-+.++|.+ .
T Consensus 426 ~~~~~-~~f~~~~e~g~Plsvd~~ss~~a~~~~s~~~~~~~~~~~ev~s~~~~~~s~~~~~~~~~~~in~vVs~~~~~~~ 504 (577)
T KOG0642|consen 426 TEESP-CTFGEPKEHGYPLSVDRTSSRPAHSLASFRFGYTSIDDMEVVSDLLIFESSASPGPRRYPQINKVVSHPTADIT 504 (577)
T ss_pred CCcCc-cccCCccccCCcceEeeccchhHhhhhhcccccccchhhhhhhheeeccccCCCcccccCccceEEecCCCCee
Confidence 43222 000 0 013456666766 5
Q ss_pred EEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 162 LAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 162 ~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
+++..++.|+++|..++ ..+.....|.. .++++++.|+|-+|++|+.||.+.+|.
T Consensus 505 ~~~hed~~Ir~~dn~~~-~~l~s~~a~~~----svtslai~~ng~~l~s~s~d~sv~l~k 559 (577)
T KOG0642|consen 505 FTAHEDRSIRFFDNKTG-KILHSMVAHKD----SVTSLAIDPNGPYLMSGSHDGSVRLWK 559 (577)
T ss_pred EecccCCceeccccccc-ccchheeeccc----eecceeecCCCceEEeecCCceeehhh
Confidence 66667889999995444 55555555543 799999999999999999888666553
No 195
>KOG2139 consensus WD40 repeat protein [General function prediction only]
Probab=99.39 E-value=1.8e-11 Score=106.59 Aligned_cols=140 Identities=16% Similarity=0.353 Sum_probs=101.3
Q ss_pred ceeEEEEcCCC-CEEEEEeCCCeEEEEeCCCC----cc----------eEEeecCCCCeEEEEEecCCCEEEEecC-CCe
Q 040274 69 RTDLMRVNPFN-GVVSLGHSGGTVTMWKPTTS----AL----------LIKMLYHQGPVSALAFHPNGHLMATTGK-ECK 132 (359)
Q Consensus 69 ~v~~l~~sp~~-~~l~tg~~dg~v~lwd~~~~----~~----------~~~~~~h~~~v~~l~~~p~g~~l~s~~~-d~~ 132 (359)
.|+||+|-|.+ ..|+.|+. +.|++|..... .+ +....+| .+|+++.|++||..+++++- |..
T Consensus 142 nvtclawRPlsaselavgCr-~gIciW~~s~tln~~r~~~~~s~~~~qvl~~pgh-~pVtsmqwn~dgt~l~tAS~gsss 219 (445)
T KOG2139|consen 142 NVTCLAWRPLSASELAVGCR-AGICIWSDSRTLNANRNIRMMSTHHLQVLQDPGH-NPVTSMQWNEDGTILVTASFGSSS 219 (445)
T ss_pred ceeEEEeccCCcceeeeeec-ceeEEEEcCcccccccccccccccchhheeCCCC-ceeeEEEEcCCCCEEeecccCcce
Confidence 89999999954 56777765 56889975421 11 1112244 68999999999999999885 678
Q ss_pred EEEEEcCCCeeeEee---cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCE
Q 040274 133 IKIWDLRKYEVLQTL---TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDV 207 (359)
Q Consensus 133 i~vwd~~~~~~~~~~---~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~ 207 (359)
|.|||..++..+.-. .+.++-+.||||| +++++.|+..++|+.... .-....... .+ .|...+|+|+|++
T Consensus 220 i~iWdpdtg~~~pL~~~glgg~slLkwSPdgd~lfaAt~davfrlw~e~q~-wt~erw~lg---sg-rvqtacWspcGsf 294 (445)
T KOG2139|consen 220 IMIWDPDTGQKIPLIPKGLGGFSLLKWSPDGDVLFAATCDAVFRLWQENQS-WTKERWILG---SG-RVQTACWSPCGSF 294 (445)
T ss_pred EEEEcCCCCCcccccccCCCceeeEEEcCCCCEEEEecccceeeeehhccc-ceecceecc---CC-ceeeeeecCCCCE
Confidence 999999998754433 4567899999999 889999999999974333 222222222 12 7999999999998
Q ss_pred EEEEeCCC
Q 040274 208 LGIGHSMG 215 (359)
Q Consensus 208 l~~g~~dg 215 (359)
|+.++...
T Consensus 295 LLf~~sgs 302 (445)
T KOG2139|consen 295 LLFACSGS 302 (445)
T ss_pred EEEEEcCC
Confidence 87665543
No 196
>KOG2110 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=99.39 E-value=4.1e-11 Score=104.65 Aligned_cols=147 Identities=17% Similarity=0.203 Sum_probs=109.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee---cCCCCeEEEEEecCCCEEEEec--CCCeEEEEEcCCCee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML---YHQGPVSALAFHPNGHLMATTG--KECKIKIWDLRKYEV 143 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~---~h~~~v~~l~~~p~g~~l~s~~--~d~~i~vwd~~~~~~ 143 (359)
+|.++.++.+ .|+++-. ..|+|||+++.+.+.++. .+...+.++++++.+.|++.-+ ..|.|.+||..+.++
T Consensus 89 ~IL~VrmNr~--RLvV~Le-e~IyIydI~~MklLhTI~t~~~n~~gl~AlS~n~~n~ylAyp~s~t~GdV~l~d~~nl~~ 165 (391)
T KOG2110|consen 89 SILAVRMNRK--RLVVCLE-ESIYIYDIKDMKLLHTIETTPPNPKGLCALSPNNANCYLAYPGSTTSGDVVLFDTINLQP 165 (391)
T ss_pred ceEEEEEccc--eEEEEEc-ccEEEEecccceeehhhhccCCCccceEeeccCCCCceEEecCCCCCceEEEEEccccee
Confidence 6777777653 4444443 459999999998887765 3455577777777778888643 368999999999888
Q ss_pred eEee---cCCceeEEEcCCC--cEEEEcCC-cEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeE
Q 040274 144 LQTL---TGHAKTLDFSQKG--LLAVGTGS-FAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWS 217 (359)
Q Consensus 144 ~~~~---~~~v~~~~~s~~g--l~~~~~d~-~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~ 217 (359)
+..+ .+.+-+++|+++| +++++..| .|+||.+..+........+- ....|.+++|+|++.+|++.+..+++
T Consensus 166 v~~I~aH~~~lAalafs~~G~llATASeKGTVIRVf~v~~G~kl~eFRRG~---~~~~IySL~Fs~ds~~L~~sS~TeTV 242 (391)
T KOG2110|consen 166 VNTINAHKGPLAALAFSPDGTLLATASEKGTVIRVFSVPEGQKLYEFRRGT---YPVSIYSLSFSPDSQFLAASSNTETV 242 (391)
T ss_pred eeEEEecCCceeEEEECCCCCEEEEeccCceEEEEEEcCCccEeeeeeCCc---eeeEEEEEEECCCCCeEEEecCCCeE
Confidence 8777 6779999999999 45555555 56899976664433322222 23479999999999999999999999
Q ss_pred EEEE
Q 040274 218 GILV 221 (359)
Q Consensus 218 ~i~~ 221 (359)
.||-
T Consensus 243 HiFK 246 (391)
T KOG2110|consen 243 HIFK 246 (391)
T ss_pred EEEE
Confidence 9874
No 197
>KOG1310 consensus WD40 repeat protein [General function prediction only]
Probab=99.38 E-value=2.9e-12 Score=116.88 Aligned_cols=152 Identities=14% Similarity=0.203 Sum_probs=116.5
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee-cCCCCeEEEEEec--CCCEEEEecCCCeEEEEEcCCCe---
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML-YHQGPVSALAFHP--NGHLMATTGKECKIKIWDLRKYE--- 142 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~-~h~~~v~~l~~~p--~g~~l~s~~~d~~i~vwd~~~~~--- 142 (359)
-|+|+.|+.+|.+|++||.|-.+.|||+-..+.+..+. +|...|.++.|-| +...+++|..|..|++||+...+
T Consensus 52 CVN~LeWn~dG~lL~SGSDD~r~ivWd~~~~KllhsI~TgHtaNIFsvKFvP~tnnriv~sgAgDk~i~lfdl~~~~~~~ 131 (758)
T KOG1310|consen 52 CVNCLEWNADGELLASGSDDTRLIVWDPFEYKLLHSISTGHTANIFSVKFVPYTNNRIVLSGAGDKLIKLFDLDSSKEGG 131 (758)
T ss_pred eecceeecCCCCEEeecCCcceEEeecchhcceeeeeecccccceeEEeeeccCCCeEEEeccCcceEEEEecccccccc
Confidence 58999999999999999999999999999888877766 8999999999998 56789999999999999998521
Q ss_pred -------eeEee---cCCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCcccc------ccccccCCCCcceeEEEEcc
Q 040274 143 -------VLQTL---TGHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYS------RYMGNSMVKGYQIGKVSFRP 203 (359)
Q Consensus 143 -------~~~~~---~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~------~~~~~~~~~~~~v~~~~~sp 203 (359)
.+..+ ...|..++-.|++ +++++.||+|+-||++....... .+..... .--...|+..+|
T Consensus 132 ~d~~~~~~~~~~~cht~rVKria~~p~~PhtfwsasEDGtirQyDiREph~c~p~~~~~~~l~ny~~-~lielk~ltisp 210 (758)
T KOG1310|consen 132 MDHGMEETTRCWSCHTDRVKRIATAPNGPHTFWSASEDGTIRQYDIREPHVCNPDEDCPSILVNYNP-QLIELKCLTISP 210 (758)
T ss_pred cccCccchhhhhhhhhhhhhheecCCCCCceEEEecCCcceeeecccCCccCCccccccHHHHHhch-hhheeeeeeecC
Confidence 12222 2346778888888 89999999999999876321111 1111000 011467889999
Q ss_pred CC-CEEEEEeCCCeEEEEE
Q 040274 204 YE-DVLGIGHSMGWSGILV 221 (359)
Q Consensus 204 ~~-~~l~~g~~dg~~~i~~ 221 (359)
.. .+|++|+.+-+.++|.
T Consensus 211 ~rp~~laVGgsdpfarLYD 229 (758)
T KOG1310|consen 211 SRPYYLAVGGSDPFARLYD 229 (758)
T ss_pred CCCceEEecCCCchhhhhh
Confidence 65 6789999999888865
No 198
>KOG0290 consensus Conserved WD40 repeat-containing protein AN11 [Function unknown]
Probab=99.38 E-value=1e-11 Score=105.21 Aligned_cols=165 Identities=13% Similarity=0.191 Sum_probs=119.3
Q ss_pred ceeEEEEcCCCC-----EEEEEeCCCeEEEEeCCCCc----ceEEee-----cCCCCeEEEEEec-CCCEEEEecCCCeE
Q 040274 69 RTDLMRVNPFNG-----VVSLGHSGGTVTMWKPTTSA----LLIKML-----YHQGPVSALAFHP-NGHLMATTGKECKI 133 (359)
Q Consensus 69 ~v~~l~~sp~~~-----~l~tg~~dg~v~lwd~~~~~----~~~~~~-----~h~~~v~~l~~~p-~g~~l~s~~~d~~i 133 (359)
+++.+.|.|+.. +|+|++ ..+++|.+.... +...+. .+..++++..|+. +.+++.+++-|.++
T Consensus 98 P~tK~~wiPd~~g~~pdlLATs~--D~LRlWri~~ee~~~~~~~~L~~~kns~~~aPlTSFDWne~dp~~igtSSiDTTC 175 (364)
T KOG0290|consen 98 PVTKLMWIPDSKGVYPDLLATSS--DFLRLWRIGDEESRVELQSVLNNNKNSEFCAPLTSFDWNEVDPNLIGTSSIDTTC 175 (364)
T ss_pred CccceEecCCccccCcchhhccc--CeEEEEeccCcCCceehhhhhccCcccccCCcccccccccCCcceeEeecccCeE
Confidence 899999999763 455543 589999987421 111111 3567899999987 78899999999999
Q ss_pred EEEEcCCCee--eEe-e---cCCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccC
Q 040274 134 KIWDLRKYEV--LQT-L---TGHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPY 204 (359)
Q Consensus 134 ~vwd~~~~~~--~~~-~---~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~ 204 (359)
.|||+.++.. +.+ + ...|.+++|...| ++++|.||.|++||++........|.... +..+...++|++.
T Consensus 176 TiWdie~~~~~~vkTQLIAHDKEV~DIaf~~~s~~~FASvgaDGSvRmFDLR~leHSTIIYE~p~--~~~pLlRLswnkq 253 (364)
T KOG0290|consen 176 TIWDIETGVSGTVKTQLIAHDKEVYDIAFLKGSRDVFASVGADGSVRMFDLRSLEHSTIIYEDPS--PSTPLLRLSWNKQ 253 (364)
T ss_pred EEEEEeeccccceeeEEEecCcceeEEEeccCccceEEEecCCCcEEEEEecccccceEEecCCC--CCCcceeeccCcC
Confidence 9999998733 222 2 5679999999966 88999999999999887655555555442 3457889999985
Q ss_pred C-CEEEEEeCCCe-EEE--------------------------------EEcCCCCCceeeeccCCC
Q 040274 205 E-DVLGIGHSMGW-SGI--------------------------------LVPRSSEPNFDSWVANPF 237 (359)
Q Consensus 205 ~-~~l~~g~~dg~-~~i--------------------------------~~~gs~~~~~~~~~~~~~ 237 (359)
. +++|+-..|+. +.| +.++++|...-+|+.+..
T Consensus 254 DpnymATf~~dS~~V~iLDiR~P~tpva~L~~H~a~VNgIaWaPhS~~hictaGDD~qaliWDl~q~ 320 (364)
T KOG0290|consen 254 DPNYMATFAMDSNKVVILDIRVPCTPVARLRNHQASVNGIAWAPHSSSHICTAGDDCQALIWDLQQM 320 (364)
T ss_pred CchHHhhhhcCCceEEEEEecCCCcceehhhcCcccccceEecCCCCceeeecCCcceEEEEecccc
Confidence 4 66776665553 111 566667888899998643
No 199
>KOG2394 consensus WD40 protein DMR-N9 [General function prediction only]
Probab=99.37 E-value=3.7e-12 Score=115.91 Aligned_cols=89 Identities=16% Similarity=0.296 Sum_probs=79.0
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee-
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL- 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~- 147 (359)
.|+.++|+|||++||+.+.||.++|+|..+.+.+..++.--+...|++|+|||+|+++|+.|.-|.||.+...+.+..-
T Consensus 292 ~in~f~FS~DG~~LA~VSqDGfLRvF~fdt~eLlg~mkSYFGGLLCvcWSPDGKyIvtGGEDDLVtVwSf~erRVVARGq 371 (636)
T KOG2394|consen 292 SINEFAFSPDGKYLATVSQDGFLRIFDFDTQELLGVMKSYFGGLLCVCWSPDGKYIVTGGEDDLVTVWSFEERRVVARGQ 371 (636)
T ss_pred cccceeEcCCCceEEEEecCceEEEeeccHHHHHHHHHhhccceEEEEEcCCccEEEecCCcceEEEEEeccceEEEecc
Confidence 7899999999999999999999999999998887777777788999999999999999999999999999887777665
Q ss_pred --cCCceeEEEc
Q 040274 148 --TGHAKTLDFS 157 (359)
Q Consensus 148 --~~~v~~~~~s 157 (359)
+..|+.++|.
T Consensus 372 GHkSWVs~VaFD 383 (636)
T KOG2394|consen 372 GHKSWVSVVAFD 383 (636)
T ss_pred ccccceeeEeec
Confidence 3446777776
No 200
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=99.37 E-value=1.6e-10 Score=105.83 Aligned_cols=172 Identities=9% Similarity=0.040 Sum_probs=111.7
Q ss_pred eEEEECCCCCEEEEecc--------------------------ceeEEEEcCCCCEEEEEe-CCCeEEEEeCCCCc----
Q 040274 52 ILWILPSSGRYMAVAGR--------------------------RTDLMRVNPFNGVVSLGH-SGGTVTMWKPTTSA---- 100 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~--------------------------~v~~l~~sp~~~~l~tg~-~dg~v~lwd~~~~~---- 100 (359)
..+.++|||++|++++. ....++|+|++++|++++ .++.|.+|++.+..
T Consensus 38 ~~l~~spd~~~lyv~~~~~~~i~~~~~~~~g~l~~~~~~~~~~~p~~i~~~~~g~~l~v~~~~~~~v~v~~~~~~g~~~~ 117 (330)
T PRK11028 38 QPMVISPDKRHLYVGVRPEFRVLSYRIADDGALTFAAESPLPGSPTHISTDHQGRFLFSASYNANCVSVSPLDKDGIPVA 117 (330)
T ss_pred ccEEECCCCCEEEEEECCCCcEEEEEECCCCceEEeeeecCCCCceEEEECCCCCEEEEEEcCCCeEEEEEECCCCCCCC
Confidence 56788888888766543 346799999999888876 48899999987432
Q ss_pred ceEEeecCCCCeEEEEEecCCCEEEEec-CCCeEEEEEcCCCeeeE-------ee--cCCceeEEEcCCC--cEEEEc-C
Q 040274 101 LLIKMLYHQGPVSALAFHPNGHLMATTG-KECKIKIWDLRKYEVLQ-------TL--TGHAKTLDFSQKG--LLAVGT-G 167 (359)
Q Consensus 101 ~~~~~~~h~~~v~~l~~~p~g~~l~s~~-~d~~i~vwd~~~~~~~~-------~~--~~~v~~~~~s~~g--l~~~~~-d 167 (359)
.+..+ .+.....+++++|+|+++++++ .++.|.+||+.+...+. .. ...+..+.|+|+| ++++.. +
T Consensus 118 ~~~~~-~~~~~~~~~~~~p~g~~l~v~~~~~~~v~v~d~~~~g~l~~~~~~~~~~~~g~~p~~~~~~pdg~~lyv~~~~~ 196 (330)
T PRK11028 118 PIQII-EGLEGCHSANIDPDNRTLWVPCLKEDRIRLFTLSDDGHLVAQEPAEVTTVEGAGPRHMVFHPNQQYAYCVNELN 196 (330)
T ss_pred ceeec-cCCCcccEeEeCCCCCEEEEeeCCCCEEEEEEECCCCcccccCCCceecCCCCCCceEEECCCCCEEEEEecCC
Confidence 22222 2334467889999999886555 56999999998632221 11 2345789999999 444443 7
Q ss_pred CcEEEEcCCCC-Cc--ccccccccc--CCCCcceeEEEEccCCCEEEEEeC-CCeEEEEEcCC
Q 040274 168 SFAQILGDFSG-SH--NYSRYMGNS--MVKGYQIGKVSFRPYEDVLGIGHS-MGWSGILVPRS 224 (359)
Q Consensus 168 ~~i~v~d~~~~-~~--~~~~~~~~~--~~~~~~v~~~~~sp~~~~l~~g~~-dg~~~i~~~gs 224 (359)
+.|.+|++... +. ....+.... .........+.|+|+|++|+++.. ++.+.+|....
T Consensus 197 ~~v~v~~~~~~~~~~~~~~~~~~~p~~~~~~~~~~~i~~~pdg~~lyv~~~~~~~I~v~~i~~ 259 (330)
T PRK11028 197 SSVDVWQLKDPHGEIECVQTLDMMPADFSDTRWAADIHITPDGRHLYACDRTASLISVFSVSE 259 (330)
T ss_pred CEEEEEEEeCCCCCEEEEEEEecCCCcCCCCccceeEEECCCCCEEEEecCCCCeEEEEEEeC
Confidence 99999997532 11 111111110 001112346889999999988854 56677765533
No 201
>COG2319 FOG: WD40 repeat [General function prediction only]
Probab=99.36 E-value=6.2e-11 Score=110.15 Aligned_cols=150 Identities=28% Similarity=0.457 Sum_probs=121.1
Q ss_pred ceeEEEEcCCCCEEEEEeC-CCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCC-EEEEecCCCeEEEEEcCCCeeeE-
Q 040274 69 RTDLMRVNPFNGVVSLGHS-GGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGH-LMATTGKECKIKIWDLRKYEVLQ- 145 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~-dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~-~l~s~~~d~~i~vwd~~~~~~~~- 145 (359)
.|.++.|+|++.++++++. |+.+.+|++.++..+..+.+|...|.+++|+|++. ++++++.|+.|.+||...+..+.
T Consensus 157 ~v~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~~~~~~~~~~~~~~d~~i~~wd~~~~~~~~~ 236 (466)
T COG2319 157 SVTSLAFSPDGKLLASGSSLDGTIKLWDLRTGKPLSTLAGHTDPVSSLAFSPDGGLLIASGSSDGTIRLWDLSTGKLLRS 236 (466)
T ss_pred cEEEEEECCCCCEEEecCCCCCceEEEEcCCCceEEeeccCCCceEEEEEcCCcceEEEEecCCCcEEEEECCCCcEEee
Confidence 7889999999998888885 99999999998888888989999999999999998 56666999999999998777777
Q ss_pred eecCCcee-E-EEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 146 TLTGHAKT-L-DFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 146 ~~~~~v~~-~-~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
.+.++... + .|+|++ +++++.++.+++|++.........+.. +...|.++.|+|++..+++++.++.+.+|.
T Consensus 237 ~~~~~~~~~~~~~~~~~~~~~~~~~d~~~~~~~~~~~~~~~~~~~~----~~~~v~~~~~~~~~~~~~~~~~d~~~~~~~ 312 (466)
T COG2319 237 TLSGHSDSVVSSFSPDGSLLASGSSDGTIRLWDLRSSSSLLRTLSG----HSSSVLSVAFSPDGKLLASGSSDGTVRLWD 312 (466)
T ss_pred ecCCCCcceeEeECCCCCEEEEecCCCcEEEeeecCCCcEEEEEec----CCccEEEEEECCCCCEEEEeeCCCcEEEEE
Confidence 46544332 2 799998 566888999999997655432223323 344899999999988888888888778883
Q ss_pred c
Q 040274 222 P 222 (359)
Q Consensus 222 ~ 222 (359)
.
T Consensus 313 ~ 313 (466)
T COG2319 313 L 313 (466)
T ss_pred c
Confidence 3
No 202
>KOG0322 consensus G-protein beta subunit-like protein GNB1L, contains WD repeats [General function prediction only]
Probab=99.35 E-value=8.3e-12 Score=104.42 Aligned_cols=148 Identities=14% Similarity=0.170 Sum_probs=113.0
Q ss_pred ceeEEEEcC-CCC--EEEEEeCCCeEEEEeCCCCc----------ceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEE
Q 040274 69 RTDLMRVNP-FNG--VVSLGHSGGTVTMWKPTTSA----------LLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKI 135 (359)
Q Consensus 69 ~v~~l~~sp-~~~--~l~tg~~dg~v~lwd~~~~~----------~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~v 135 (359)
.+.|..+.. ++. ++++|-.+|.|.+||+.++. .+.....|..+|.++.|.+.-..=++++.+..+..
T Consensus 152 svmc~~~~~~c~s~~lllaGyEsghvv~wd~S~~~~~~~~~~~~kv~~~~ash~qpvlsldyas~~~rGisgga~dkl~~ 231 (323)
T KOG0322|consen 152 SVMCQDKDHACGSTFLLLAGYESGHVVIWDLSTGDKIIQLPQSSKVESPNASHKQPVLSLDYASSCDRGISGGADDKLVM 231 (323)
T ss_pred ceeeeeccccccceEEEEEeccCCeEEEEEccCCceeeccccccccccchhhccCcceeeeechhhcCCcCCCcccccee
Confidence 577777544 333 46677889999999999873 33344579999999999886555678888888999
Q ss_pred EEcCC--Cee----eEee-cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCC
Q 040274 136 WDLRK--YEV----LQTL-TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYED 206 (359)
Q Consensus 136 wd~~~--~~~----~~~~-~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~ 206 (359)
|.+.. +.+ ..++ ...+..+.+-||+ ++++|+|+.|+||+.++. .++..+..|.. .|++++|+|+..
T Consensus 232 ~Sl~~s~gslq~~~e~~lknpGv~gvrIRpD~KIlATAGWD~RiRVyswrtl-~pLAVLkyHsa----gvn~vAfspd~~ 306 (323)
T KOG0322|consen 232 YSLNHSTGSLQIRKEITLKNPGVSGVRIRPDGKILATAGWDHRIRVYSWRTL-NPLAVLKYHSA----GVNAVAFSPDCE 306 (323)
T ss_pred eeeccccCcccccceEEecCCCccceEEccCCcEEeecccCCcEEEEEeccC-Cchhhhhhhhc----ceeEEEeCCCCc
Confidence 98864 322 1122 3347889999999 788999999999996554 56666666654 899999999999
Q ss_pred EEEEEeCCCeEEEEE
Q 040274 207 VLGIGHSMGWSGILV 221 (359)
Q Consensus 207 ~l~~g~~dg~~~i~~ 221 (359)
++|.++.|+.|++|.
T Consensus 307 lmAaaskD~rISLWk 321 (323)
T KOG0322|consen 307 LMAAASKDARISLWK 321 (323)
T ss_pred hhhhccCCceEEeee
Confidence 999999999888874
No 203
>KOG1587 consensus Cytoplasmic dynein intermediate chain [Cytoskeleton]
Probab=99.35 E-value=2.3e-11 Score=115.89 Aligned_cols=115 Identities=17% Similarity=0.246 Sum_probs=83.9
Q ss_pred EeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcC-CCeeeEee---cCCceeEEEcCCC---cEEEEcCCcEEEEcCC
Q 040274 104 KMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLR-KYEVLQTL---TGHAKTLDFSQKG---LLAVGTGSFAQILGDF 176 (359)
Q Consensus 104 ~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~-~~~~~~~~---~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~ 176 (359)
.+..|.++|+++.++|=+..++.++.|.+|+||... ...++..+ ...+++++|||.- ++++..+|.|.+||+.
T Consensus 393 ~~~~h~g~v~~v~~nPF~~k~fls~gDW~vriWs~~~~~~Pl~~~~~~~~~v~~vaWSptrpavF~~~d~~G~l~iWDLl 472 (555)
T KOG1587|consen 393 TFITHIGPVYAVSRNPFYPKNFLSVGDWTVRIWSEDVIASPLLSLDSSPDYVTDVAWSPTRPAVFATVDGDGNLDIWDLL 472 (555)
T ss_pred cccccCcceEeeecCCCccceeeeeccceeEeccccCCCCcchhhhhccceeeeeEEcCcCceEEEEEcCCCceehhhhh
Confidence 344678899999999966665555559999999887 55666666 3458999999987 6667779999999976
Q ss_pred CCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 177 SGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
... ..+...+.. .....+.+.|++.|++|++|...|.+.++.
T Consensus 473 ~~~--~~Pv~s~~~-~~~~l~~~~~s~~g~~lavGd~~G~~~~~~ 514 (555)
T KOG1587|consen 473 QDD--EEPVLSQKV-CSPALTRVRWSPNGKLLAVGDANGTTHILK 514 (555)
T ss_pred ccc--cCCcccccc-cccccceeecCCCCcEEEEecCCCcEEEEE
Confidence 542 222222211 233577888999999999999998666654
No 204
>PRK02889 tolB translocation protein TolB; Provisional
Probab=99.34 E-value=6.3e-11 Score=112.26 Aligned_cols=156 Identities=15% Similarity=0.113 Sum_probs=103.2
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCCCCEEE-EEeCCCeEEEEe--CCCCcceE
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPFNGVVS-LGHSGGTVTMWK--PTTSALLI 103 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~~~~l~-tg~~dg~v~lwd--~~~~~~~~ 103 (359)
.+.+|||||+.|++.+. .+.+.+|+|||..|+ +.+.+|...||. +.++. +.
T Consensus 199 ~~p~wSPDG~~la~~s~~~~~~~I~~~dl~~g~~~~l~~~~g~~~~~~~SPDG~~la~~~~~~g~~~Iy~~d~~~~~-~~ 277 (427)
T PRK02889 199 ISPAWSPDGTKLAYVSFESKKPVVYVHDLATGRRRVVANFKGSNSAPAWSPDGRTLAVALSRDGNSQIYTVNADGSG-LR 277 (427)
T ss_pred ccceEcCCCCEEEEEEccCCCcEEEEEECCCCCEEEeecCCCCccceEECCCCCEEEEEEccCCCceEEEEECCCCC-cE
Confidence 67899999999987653 345789999998876 456777766665 44443 45
Q ss_pred EeecCCCCeEEEEEecCCCEEEEecC-CCeEEEE--EcCCCeeeE-eec-CCceeEEEcCCC--cEEEEcCC---cEEEE
Q 040274 104 KMLYHQGPVSALAFHPNGHLMATTGK-ECKIKIW--DLRKYEVLQ-TLT-GHAKTLDFSQKG--LLAVGTGS---FAQIL 173 (359)
Q Consensus 104 ~~~~h~~~v~~l~~~p~g~~l~s~~~-d~~i~vw--d~~~~~~~~-~~~-~~v~~~~~s~~g--l~~~~~d~---~i~v~ 173 (359)
.+..+.+.+.++.|+|||+.|+.++. ++...+| |+.++.... ++. ......+|||+| ++.++.++ .|.+|
T Consensus 278 ~lt~~~~~~~~~~wSpDG~~l~f~s~~~g~~~Iy~~~~~~g~~~~lt~~g~~~~~~~~SpDG~~Ia~~s~~~g~~~I~v~ 357 (427)
T PRK02889 278 RLTQSSGIDTEPFFSPDGRSIYFTSDRGGAPQIYRMPASGGAAQRVTFTGSYNTSPRISPDGKLLAYISRVGGAFKLYVQ 357 (427)
T ss_pred ECCCCCCCCcCeEEcCCCCEEEEEecCCCCcEEEEEECCCCceEEEecCCCCcCceEECCCCCEEEEEEccCCcEEEEEE
Confidence 55556666778899999998876554 4555555 444444322 222 234568999999 44444333 69999
Q ss_pred cCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 174 GDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 174 d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
|+..+. .. .+... . ....+.|+|||+.|+.++.++
T Consensus 358 d~~~g~-~~-~lt~~-~----~~~~p~~spdg~~l~~~~~~~ 392 (427)
T PRK02889 358 DLATGQ-VT-ALTDT-T----RDESPSFAPNGRYILYATQQG 392 (427)
T ss_pred ECCCCC-eE-EccCC-C----CccCceECCCCCEEEEEEecC
Confidence 965542 22 22221 1 346789999999988877654
No 205
>KOG1587 consensus Cytoplasmic dynein intermediate chain [Cytoskeleton]
Probab=99.34 E-value=5.6e-11 Score=113.25 Aligned_cols=147 Identities=16% Similarity=0.153 Sum_probs=104.8
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCCcc--eEE----eecCCCCeEEEEEecCCC--EEEEecCCCeEEEEEcC
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTSAL--LIK----MLYHQGPVSALAFHPNGH--LMATTGKECKIKIWDLR 139 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~~--~~~----~~~h~~~v~~l~~~p~g~--~l~s~~~d~~i~vwd~~ 139 (359)
.|+|+.|+| +..+++.|+.+|.|.+||+..+.. ... ...|..+|+.+.|..+.. -|++++.||.|..|+++
T Consensus 244 ~v~~~~f~p~~p~ll~gG~y~GqV~lWD~~~~~~~~~s~ls~~~~sh~~~v~~vvW~~~~~~~~f~s~ssDG~i~~W~~~ 323 (555)
T KOG1587|consen 244 EVTCLKFCPFDPNLLAGGCYNGQVVLWDLRKGSDTPPSGLSALEVSHSEPVTAVVWLQNEHNTEFFSLSSDGSICSWDTD 323 (555)
T ss_pred ceeEEEeccCCcceEEeeccCceEEEEEccCCCCCCCcccccccccCCcCeEEEEEeccCCCCceEEEecCCcEeeeecc
Confidence 899999999 667888899999999999986643 221 226899999999976544 49999999999999987
Q ss_pred CCee-eEee--------------cCCceeEEEcCCC---cEEEEcCCcEEEEc---CCCCC----ccccccccccCCCCc
Q 040274 140 KYEV-LQTL--------------TGHAKTLDFSQKG---LLAVGTGSFAQILG---DFSGS----HNYSRYMGNSMVKGY 194 (359)
Q Consensus 140 ~~~~-~~~~--------------~~~v~~~~~s~~g---l~~~~~d~~i~v~d---~~~~~----~~~~~~~~~~~~~~~ 194 (359)
.... .... ...++++.|.+.. ++.|+.+|.|.-=+ ..... +....+.. |.+
T Consensus 324 ~l~~P~e~~~~~~~~~~~~~~~~~~~~t~~~F~~~~p~~FiVGTe~G~v~~~~r~g~~~~~~~~~~~~~~~~~----h~g 399 (555)
T KOG1587|consen 324 MLSLPVEGLLLESKKHKGQQSSKAVGATSLKFEPTDPNHFIVGTEEGKVYKGCRKGYTPAPEVSYKGHSTFIT----HIG 399 (555)
T ss_pred ccccchhhcccccccccccccccccceeeEeeccCCCceEEEEcCCcEEEEEeccCCcccccccccccccccc----cCc
Confidence 5332 1111 1236889998876 88888889887622 11111 11222333 445
Q ss_pred ceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 195 QIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 195 ~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
+|+++.++|.+.-+...+.|.+++|
T Consensus 400 ~v~~v~~nPF~~k~fls~gDW~vri 424 (555)
T KOG1587|consen 400 PVYAVSRNPFYPKNFLSVGDWTVRI 424 (555)
T ss_pred ceEeeecCCCccceeeeeccceeEe
Confidence 8999999999876666666888777
No 206
>KOG0644 consensus Uncharacterized conserved protein, contains WD40 repeat and BROMO domains [General function prediction only]
Probab=99.34 E-value=1.1e-12 Score=124.92 Aligned_cols=145 Identities=17% Similarity=0.220 Sum_probs=115.5
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee-
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL- 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~- 147 (359)
.|.|..|...|.+|++|+.|..|.||...+..++..+.||.+.|+.++.+.+..++++++.|..|++|-+..+.++..+
T Consensus 192 aVyca~fDrtg~~Iitgsdd~lvKiwS~et~~~lAs~rGhs~ditdlavs~~n~~iaaaS~D~vIrvWrl~~~~pvsvLr 271 (1113)
T KOG0644|consen 192 AVYCAIFDRTGRYIITGSDDRLVKIWSMETARCLASCRGHSGDITDLAVSSNNTMIAAASNDKVIRVWRLPDGAPVSVLR 271 (1113)
T ss_pred heeeeeeccccceEeecCccceeeeeeccchhhhccCCCCccccchhccchhhhhhhhcccCceEEEEecCCCchHHHHh
Confidence 7999999999999999999999999999999999999999999999999999889999999999999999999987777
Q ss_pred --cCCceeEEEcCCCcEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCe
Q 040274 148 --TGHAKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGW 216 (359)
Q Consensus 148 --~~~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~ 216 (359)
.|.|++++|+|. .+.+.||++++||.+.......+-+.... .+..+.++.|...+.-+++|+.++.
T Consensus 272 ghtgavtaiafsP~--~sss~dgt~~~wd~r~~~~~y~prp~~~~-~~~~~~s~~~~~~~~~f~Tgs~d~e 339 (1113)
T KOG0644|consen 272 GHTGAVTAIAFSPR--ASSSDDGTCRIWDARLEPRIYVPRPLKFT-EKDLVDSILFENNGDRFLTGSRDGE 339 (1113)
T ss_pred ccccceeeeccCcc--ccCCCCCceEeccccccccccCCCCCCcc-cccceeeeeccccccccccccCCcc
Confidence 566999999995 47788999999996522111111111000 1234666666666666666666664
No 207
>KOG3881 consensus Uncharacterized conserved protein [Function unknown]
Probab=99.33 E-value=1.6e-10 Score=101.73 Aligned_cols=152 Identities=13% Similarity=0.115 Sum_probs=117.1
Q ss_pred ceeEEEEcCCCC-EEEEEeCC--CeEEEEeCCCCcceEEeecCC---------CCeEEEEEecC--CCEEEEecCCCeEE
Q 040274 69 RTDLMRVNPFNG-VVSLGHSG--GTVTMWKPTTSALLIKMLYHQ---------GPVSALAFHPN--GHLMATTGKECKIK 134 (359)
Q Consensus 69 ~v~~l~~sp~~~-~l~tg~~d--g~v~lwd~~~~~~~~~~~~h~---------~~v~~l~~~p~--g~~l~s~~~d~~i~ 134 (359)
.+..|..+|... ++++|+.. ..+.+||+.+.+.+..-+.-. -.++++.|-+. ...|++++.-+.|+
T Consensus 150 g~~~~r~~~~~p~Iva~GGke~~n~lkiwdle~~~qiw~aKNvpnD~L~LrVPvW~tdi~Fl~g~~~~~fat~T~~hqvR 229 (412)
T KOG3881|consen 150 GLYDVRQTDTDPYIVATGGKENINELKIWDLEQSKQIWSAKNVPNDRLGLRVPVWITDIRFLEGSPNYKFATITRYHQVR 229 (412)
T ss_pred ceeeeccCCCCCceEecCchhcccceeeeecccceeeeeccCCCCccccceeeeeeccceecCCCCCceEEEEecceeEE
Confidence 577777777544 56668877 789999999875554433211 13567888776 77899999999999
Q ss_pred EEEcCCCe-eeEee---cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEE
Q 040274 135 IWDLRKYE-VLQTL---TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVL 208 (359)
Q Consensus 135 vwd~~~~~-~~~~~---~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l 208 (359)
+||.+.+. ++..| ..+++++...|+| ++++..-+.+..||++........+.+..+ .|.++..+|.+.+|
T Consensus 230 ~YDt~~qRRPV~~fd~~E~~is~~~l~p~gn~Iy~gn~~g~l~~FD~r~~kl~g~~~kg~tG----sirsih~hp~~~~l 305 (412)
T KOG3881|consen 230 LYDTRHQRRPVAQFDFLENPISSTGLTPSGNFIYTGNTKGQLAKFDLRGGKLLGCGLKGITG----SIRSIHCHPTHPVL 305 (412)
T ss_pred EecCcccCcceeEeccccCcceeeeecCCCcEEEEecccchhheecccCceeeccccCCccC----CcceEEEcCCCceE
Confidence 99999764 66666 5678999999999 777778899999997666433334566544 79999999999999
Q ss_pred EEEeCCCeEEEEEcCC
Q 040274 209 GIGHSMGWSGILVPRS 224 (359)
Q Consensus 209 ~~g~~dg~~~i~~~gs 224 (359)
++++-|.+++|+..-+
T Consensus 306 as~GLDRyvRIhD~kt 321 (412)
T KOG3881|consen 306 ASCGLDRYVRIHDIKT 321 (412)
T ss_pred EeeccceeEEEeeccc
Confidence 9999999998887654
No 208
>PRK05137 tolB translocation protein TolB; Provisional
Probab=99.33 E-value=1.5e-10 Score=110.12 Aligned_cols=155 Identities=10% Similarity=0.076 Sum_probs=107.1
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCCCCEEE-EEeCCCe--EEEEeCCCCcceE
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPFNGVVS-LGHSGGT--VTMWKPTTSALLI 103 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~~~~l~-tg~~dg~--v~lwd~~~~~~~~ 103 (359)
.+..|||||+.|++.+. .+.+.+|+|||..|+ +.+.+|. |++||+.++.. .
T Consensus 205 ~~p~wSpDG~~lay~s~~~g~~~i~~~dl~~g~~~~l~~~~g~~~~~~~SPDG~~la~~~~~~g~~~Iy~~d~~~~~~-~ 283 (435)
T PRK05137 205 LTPRFSPNRQEITYMSYANGRPRVYLLDLETGQRELVGNFPGMTFAPRFSPDGRKVVMSLSQGGNTDIYTMDLRSGTT-T 283 (435)
T ss_pred EeeEECCCCCEEEEEEecCCCCEEEEEECCCCcEEEeecCCCcccCcEECCCCCEEEEEEecCCCceEEEEECCCCce-E
Confidence 78899999999987642 456788999998765 4555554 77889887754 4
Q ss_pred EeecCCCCeEEEEEecCCCEEEEecC-C--CeEEEEEcCCCeeeEee--cCCceeEEEcCCC--cEEEEcC---CcEEEE
Q 040274 104 KMLYHQGPVSALAFHPNGHLMATTGK-E--CKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG--LLAVGTG---SFAQIL 173 (359)
Q Consensus 104 ~~~~h~~~v~~l~~~p~g~~l~s~~~-d--~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g--l~~~~~d---~~i~v~ 173 (359)
.+..+.+...+.+|+|||+.|+.++. + ..|++||+..+...... .+.+..+.|||+| ++..+.+ ..|.+|
T Consensus 284 ~Lt~~~~~~~~~~~spDG~~i~f~s~~~g~~~Iy~~d~~g~~~~~lt~~~~~~~~~~~SpdG~~ia~~~~~~~~~~i~~~ 363 (435)
T PRK05137 284 RLTDSPAIDTSPSYSPDGSQIVFESDRSGSPQLYVMNADGSNPRRISFGGGRYSTPVWSPRGDLIAFTKQGGGQFSIGVM 363 (435)
T ss_pred EccCCCCccCceeEcCCCCEEEEEECCCCCCeEEEEECCCCCeEEeecCCCcccCeEECCCCCEEEEEEcCCCceEEEEE
Confidence 45566667788999999998887664 3 36889998766543322 3456778999999 4444432 367888
Q ss_pred cCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 174 GDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 174 d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
|+... . ...+ ... ..+.++.|+|||+.|+..+.+
T Consensus 364 d~~~~-~-~~~l-t~~----~~~~~p~~spDG~~i~~~~~~ 397 (435)
T PRK05137 364 KPDGS-G-ERIL-TSG----FLVEGPTWAPNGRVIMFFRQT 397 (435)
T ss_pred ECCCC-c-eEec-cCC----CCCCCCeECCCCCEEEEEEcc
Confidence 85332 2 2222 111 146788999999998776653
No 209
>PRK04922 tolB translocation protein TolB; Provisional
Probab=99.32 E-value=1.2e-10 Score=110.53 Aligned_cols=155 Identities=12% Similarity=0.066 Sum_probs=105.5
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCCCCEEE-EEeCCC--eEEEEeCCCCcceE
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPFNGVVS-LGHSGG--TVTMWKPTTSALLI 103 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~~~~l~-tg~~dg--~v~lwd~~~~~~~~ 103 (359)
.+..|+|||++|++.+. ...++.|+|+|..|+ +.+.+| .|++||+.++.. .
T Consensus 207 ~~p~wSpDg~~la~~s~~~~~~~l~~~dl~~g~~~~l~~~~g~~~~~~~SpDG~~l~~~~s~~g~~~Iy~~d~~~g~~-~ 285 (433)
T PRK04922 207 LSPAWSPDGKKLAYVSFERGRSAIYVQDLATGQRELVASFRGINGAPSFSPDGRRLALTLSRDGNPEIYVMDLGSRQL-T 285 (433)
T ss_pred ccccCCCCCCEEEEEecCCCCcEEEEEECCCCCEEEeccCCCCccCceECCCCCEEEEEEeCCCCceEEEEECCCCCe-E
Confidence 77899999999997653 234789999998765 445555 599999988764 4
Q ss_pred EeecCCCCeEEEEEecCCCEEEEecC-CC--eEEEEEcCCCeeeE-eec-CCceeEEEcCCC--cEEEEcC---CcEEEE
Q 040274 104 KMLYHQGPVSALAFHPNGHLMATTGK-EC--KIKIWDLRKYEVLQ-TLT-GHAKTLDFSQKG--LLAVGTG---SFAQIL 173 (359)
Q Consensus 104 ~~~~h~~~v~~l~~~p~g~~l~s~~~-d~--~i~vwd~~~~~~~~-~~~-~~v~~~~~s~~g--l~~~~~d---~~i~v~ 173 (359)
.+..+......++|+|||+.|+.++. ++ .|+++|+.+++... ++. .....++|||+| ++..+.+ ..|.+|
T Consensus 286 ~lt~~~~~~~~~~~spDG~~l~f~sd~~g~~~iy~~dl~~g~~~~lt~~g~~~~~~~~SpDG~~Ia~~~~~~~~~~I~v~ 365 (433)
T PRK04922 286 RLTNHFGIDTEPTWAPDGKSIYFTSDRGGRPQIYRVAASGGSAERLTFQGNYNARASVSPDGKKIAMVHGSGGQYRIAVM 365 (433)
T ss_pred ECccCCCCccceEECCCCCEEEEEECCCCCceEEEEECCCCCeEEeecCCCCccCEEECCCCCEEEEEECCCCceeEEEE
Confidence 45556666678999999998877664 44 47777877765432 222 234578999999 4333333 268999
Q ss_pred cCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 174 GDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 174 d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
|+..+ ... .+ .+. .....+.|+|||++|+..+.+
T Consensus 366 d~~~g-~~~-~L-t~~----~~~~~p~~spdG~~i~~~s~~ 399 (433)
T PRK04922 366 DLSTG-SVR-TL-TPG----SLDESPSFAPNGSMVLYATRE 399 (433)
T ss_pred ECCCC-CeE-EC-CCC----CCCCCceECCCCCEEEEEEec
Confidence 96544 222 22 221 134567999999988876654
No 210
>KOG4227 consensus WD40 repeat protein [General function prediction only]
Probab=99.32 E-value=4.4e-11 Score=105.16 Aligned_cols=151 Identities=11% Similarity=0.179 Sum_probs=120.2
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCC------CCcceEEee-cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCC
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPT------TSALLIKML-YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKY 141 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~------~~~~~~~~~-~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~ 141 (359)
-|+++.|+.++.+|++|+.|..+++|++. +.+++.... .|.+.|.|++|+.....+++|+.+++|.+.|+.+.
T Consensus 58 CiNAlqFS~N~~~L~SGGDD~~~~~W~~de~~~~k~~KPI~~~~~~H~SNIF~L~F~~~N~~~~SG~~~~~VI~HDiEt~ 137 (609)
T KOG4227|consen 58 CINALQFSHNDRFLASGGDDMHGRVWNVDELMVRKTPKPIGVMEHPHRSNIFSLEFDLENRFLYSGERWGTVIKHDIETK 137 (609)
T ss_pred ccceeeeccCCeEEeecCCcceeeeechHHHHhhcCCCCceeccCccccceEEEEEccCCeeEecCCCcceeEeeecccc
Confidence 58999999999999999999999999975 446666654 45689999999999999999999999999999999
Q ss_pred eeeEee-----cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCC-CEEEEEeC
Q 040274 142 EVLQTL-----TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYE-DVLGIGHS 213 (359)
Q Consensus 142 ~~~~~~-----~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~-~~l~~g~~ 213 (359)
+.+..+ .+.|+.+..+|.. +++++.++.|.+||.+.......++..-. .+....++-|+|.. .+|++.+.
T Consensus 138 qsi~V~~~~~~~~~VY~m~~~P~DN~~~~~t~~~~V~~~D~Rd~~~~~~~~~~AN--~~~~F~t~~F~P~~P~Li~~~~~ 215 (609)
T KOG4227|consen 138 QSIYVANENNNRGDVYHMDQHPTDNTLIVVTRAKLVSFIDNRDRQNPISLVLPAN--SGKNFYTAEFHPETPALILVNSE 215 (609)
T ss_pred eeeeeecccCcccceeecccCCCCceEEEEecCceEEEEeccCCCCCCceeeecC--CCccceeeeecCCCceeEEeccc
Confidence 888877 3578999999976 77788889999999776644444332221 33457889999976 56677777
Q ss_pred CCeEEEEE
Q 040274 214 MGWSGILV 221 (359)
Q Consensus 214 dg~~~i~~ 221 (359)
.+-+.+|.
T Consensus 216 ~~G~~~~D 223 (609)
T KOG4227|consen 216 TGGPNVFD 223 (609)
T ss_pred cCCCCcee
Confidence 77665553
No 211
>KOG2111 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=99.30 E-value=4.6e-10 Score=96.42 Aligned_cols=99 Identities=21% Similarity=0.311 Sum_probs=82.3
Q ss_pred CEEEE-EeCCCeEEEEeCCCCcc--eEEeecCCCCeEEEEEecCCCEEEEecCCCe-EEEEEcCCCeeeEee-----cCC
Q 040274 80 GVVSL-GHSGGTVTMWKPTTSAL--LIKMLYHQGPVSALAFHPNGHLMATTGKECK-IKIWDLRKYEVLQTL-----TGH 150 (359)
Q Consensus 80 ~~l~t-g~~dg~v~lwd~~~~~~--~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~-i~vwd~~~~~~~~~~-----~~~ 150 (359)
.+|+. |..-|.|+|-|+..... ...+.+|.+.|.|++.+-+|.++||+|..|+ |+|||..+|..+.++ ...
T Consensus 149 ~~LafPg~k~GqvQi~dL~~~~~~~p~~I~AH~s~Iacv~Ln~~Gt~vATaStkGTLIRIFdt~~g~~l~E~RRG~d~A~ 228 (346)
T KOG2111|consen 149 SLLAFPGFKTGQVQIVDLASTKPNAPSIINAHDSDIACVALNLQGTLVATASTKGTLIRIFDTEDGTLLQELRRGVDRAD 228 (346)
T ss_pred eEEEcCCCccceEEEEEhhhcCcCCceEEEcccCceeEEEEcCCccEEEEeccCcEEEEEEEcCCCcEeeeeecCCchhe
Confidence 34444 44669999999886554 4677899999999999999999999999998 899999999999999 245
Q ss_pred ceeEEEcCCC-cEEEEcC-CcEEEEcCCCC
Q 040274 151 AKTLDFSQKG-LLAVGTG-SFAQILGDFSG 178 (359)
Q Consensus 151 v~~~~~s~~g-l~~~~~d-~~i~v~d~~~~ 178 (359)
+.+++|||++ ++++++| |+|+||.+...
T Consensus 229 iy~iaFSp~~s~LavsSdKgTlHiF~l~~~ 258 (346)
T KOG2111|consen 229 IYCIAFSPNSSWLAVSSDKGTLHIFSLRDT 258 (346)
T ss_pred EEEEEeCCCccEEEEEcCCCeEEEEEeecC
Confidence 8999999999 6666665 89999987553
No 212
>KOG1517 consensus Guanine nucleotide binding protein MIP1 [Cell cycle control, cell division, chromosome partitioning]
Probab=99.30 E-value=4.4e-11 Score=116.74 Aligned_cols=154 Identities=16% Similarity=0.228 Sum_probs=113.6
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCC---cceEEeecCCCC--eEEEEEecCCCE-EEEecCCCeEEEEEcCCC
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTS---ALLIKMLYHQGP--VSALAFHPNGHL-MATTGKECKIKIWDLRKY 141 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~---~~~~~~~~h~~~--v~~l~~~p~g~~-l~s~~~d~~i~vwd~~~~ 141 (359)
.|++|.-+- .|++|++|..||+|++||.+.. ..+..+..|+.. |..+.+.+.|-- |++|+.||.|++||+|..
T Consensus 1210 ~vTaLS~~~~~gn~i~AGfaDGsvRvyD~R~a~~ds~v~~~R~h~~~~~Iv~~slq~~G~~elvSgs~~G~I~~~DlR~~ 1289 (1387)
T KOG1517|consen 1210 LVTALSADLVHGNIIAAGFADGSVRVYDRRMAPPDSLVCVYREHNDVEPIVHLSLQRQGLGELVSGSQDGDIQLLDLRMS 1289 (1387)
T ss_pred cceeecccccCCceEEEeecCCceEEeecccCCccccceeecccCCcccceeEEeecCCCcceeeeccCCeEEEEecccC
Confidence 456665544 4689999999999999998754 346667788887 999999997765 999999999999999984
Q ss_pred eeeE--ee-c----C-CceeEEEcCCC-cEEEEcCCcEEEEcCCCCCcc-ccccccccCCCCcceeEEEEccCCCEEEEE
Q 040274 142 EVLQ--TL-T----G-HAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHN-YSRYMGNSMVKGYQIGKVSFRPYEDVLGIG 211 (359)
Q Consensus 142 ~~~~--~~-~----~-~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~-~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g 211 (359)
.... ++ . | ..+++..+++. ++++|..+.|.||++....-. ...+....+.....+.|++|+|.--.|++|
T Consensus 1290 ~~e~~~~iv~~~~yGs~lTal~VH~hapiiAsGs~q~ikIy~~~G~~l~~~k~n~~F~~q~~gs~scL~FHP~~~llAaG 1369 (1387)
T KOG1517|consen 1290 SKETFLTIVAHWEYGSALTALTVHEHAPIIASGSAQLIKIYSLSGEQLNIIKYNPGFMGQRIGSVSCLAFHPHRLLLAAG 1369 (1387)
T ss_pred cccccceeeeccccCccceeeeeccCCCeeeecCcceEEEEecChhhhcccccCcccccCcCCCcceeeecchhHhhhhc
Confidence 2111 11 1 3 48999999988 777777799999995432111 111111111123468999999999999999
Q ss_pred eCCCeEEEEEc
Q 040274 212 HSMGWSGILVP 222 (359)
Q Consensus 212 ~~dg~~~i~~~ 222 (359)
+.|.++.||-.
T Consensus 1370 ~~Ds~V~iYs~ 1380 (1387)
T KOG1517|consen 1370 SADSTVSIYSC 1380 (1387)
T ss_pred cCCceEEEeec
Confidence 99999988865
No 213
>KOG1240 consensus Protein kinase containing WD40 repeats [Signal transduction mechanisms]
Probab=99.28 E-value=1.1e-10 Score=115.56 Aligned_cols=179 Identities=13% Similarity=0.054 Sum_probs=126.4
Q ss_pred eEEEECCCCCEEEEecc---ceeEEEEcCC-CCEEEEEeCCCeEEEEeCCCC-------cceEEeecCCCCeEEEEEecC
Q 040274 52 ILWILPSSGRYMAVAGR---RTDLMRVNPF-NGVVSLGHSGGTVTMWKPTTS-------ALLIKMLYHQGPVSALAFHPN 120 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~---~v~~l~~sp~-~~~l~tg~~dg~v~lwd~~~~-------~~~~~~~~h~~~v~~l~~~p~ 120 (359)
....|.|.|..+|.-.. .+..++.++. +.+|++||.||+|++|+...- ....++....+.+.++.+.+.
T Consensus 1030 p~~gW~p~G~lVAhL~Ehs~~v~k~a~s~~~~s~FvsgS~DGtVKvW~~~k~~~~~~s~rS~ltys~~~sr~~~vt~~~~ 1109 (1431)
T KOG1240|consen 1030 PPPGWNPRGILVAHLHEHSSAVIKLAVSSEHTSLFVSGSDDGTVKVWNLRKLEGEGGSARSELTYSPEGSRVEKVTMCGN 1109 (1431)
T ss_pred CCCCCCccceEeehhhhccccccceeecCCCCceEEEecCCceEEEeeehhhhcCcceeeeeEEEeccCCceEEEEeccC
Confidence 44456777877775433 6778888774 599999999999999997631 233344445778999999999
Q ss_pred CCEEEEecCCCeEEEEEcCCC-------------------eeeE---------e----e---------------------
Q 040274 121 GHLMATTGKECKIKIWDLRKY-------------------EVLQ---------T----L--------------------- 147 (359)
Q Consensus 121 g~~l~s~~~d~~i~vwd~~~~-------------------~~~~---------~----~--------------------- 147 (359)
+..+|+++.||.|.+.++... ..+. + +
T Consensus 1110 ~~~~Av~t~DG~v~~~~id~~~~~~~~~~~~ri~n~~~~g~vv~m~a~~~~~~S~~lvy~T~~~~iv~~D~r~~~~~w~l 1189 (1431)
T KOG1240|consen 1110 GDQFAVSTKDGSVRVLRIDHYNVSKRVATQVRIPNLKKDGVVVSMHAFTAIVQSHVLVYATDLSRIVSWDTRMRHDAWRL 1189 (1431)
T ss_pred CCeEEEEcCCCeEEEEEccccccccceeeeeecccccCCCceEEeecccccccceeEEEEEeccceEEecchhhhhHHhh
Confidence 999999999999999876430 0000 0 0
Q ss_pred -----cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCC---CEEEEEeC--CC
Q 040274 148 -----TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYE---DVLGIGHS--MG 215 (359)
Q Consensus 148 -----~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~---~~l~~g~~--dg 215 (359)
.|.|++++.+|.+ ++.|+..|.+.+||++..-....-... +..++..+..+|.. .+.++++. .+
T Consensus 1190 k~~~~hG~vTSi~idp~~~WlviGts~G~l~lWDLRF~~~i~sw~~P----~~~~i~~v~~~~~~~~~S~~vs~~~~~~n 1265 (1431)
T KOG1240|consen 1190 KNQLRHGLVTSIVIDPWCNWLVIGTSRGQLVLWDLRFRVPILSWEHP----ARAPIRHVWLCPTYPQESVSVSAGSSSNN 1265 (1431)
T ss_pred hcCccccceeEEEecCCceEEEEecCCceEEEEEeecCceeecccCc----ccCCcceEEeeccCCCCceEEEecccCCC
Confidence 1347889999998 777888899999998776322222122 23477777777743 45555544 66
Q ss_pred eEEEEEcCCCCCceeeecc
Q 040274 216 WSGILVPRSSEPNFDSWVA 234 (359)
Q Consensus 216 ~~~i~~~gs~~~~~~~~~~ 234 (359)
.+++|....|.+...+|..
T Consensus 1266 evs~wn~~~g~~~~vl~~s 1284 (1431)
T KOG1240|consen 1266 EVSTWNMETGLRQTVLWAS 1284 (1431)
T ss_pred ceeeeecccCcceEEEEcC
Confidence 7899988888888888876
No 214
>PRK01742 tolB translocation protein TolB; Provisional
Probab=99.24 E-value=9.1e-11 Score=111.26 Aligned_cols=146 Identities=14% Similarity=0.143 Sum_probs=100.7
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCCCCEEEEEe-CCCeEEEEeCCCCcceEEe
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPFNGVVSLGH-SGGTVTMWKPTTSALLIKM 105 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~~~~l~tg~-~dg~v~lwd~~~~~~~~~~ 105 (359)
.+++|+|||++|++++. .+.+..|+|||..|+.++ .+|.+.||+++........
T Consensus 251 ~~~~wSPDG~~La~~~~~~g~~~Iy~~d~~~~~~~~lt~~~~~~~~~~wSpDG~~i~f~s~~~g~~~I~~~~~~~~~~~~ 330 (429)
T PRK01742 251 GAPAFSPDGSRLAFASSKDGVLNIYVMGANGGTPSQLTSGAGNNTEPSWSPDGQSILFTSDRSGSPQVYRMSASGGGASL 330 (429)
T ss_pred CceeECCCCCEEEEEEecCCcEEEEEEECCCCCeEeeccCCCCcCCEEECCCCCEEEEEECCCCCceEEEEECCCCCeEE
Confidence 57899999999887642 356899999999777655 5788888876543222222
Q ss_pred ecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee-cCCceeEEEcCCC--cEEEEcCCcEEEEcCCC-CCcc
Q 040274 106 LYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL-TGHAKTLDFSQKG--LLAVGTGSFAQILGDFS-GSHN 181 (359)
Q Consensus 106 ~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~-~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~-~~~~ 181 (359)
..+.+ .++.|+|+|.+|++++.++ +.+||+.++...... .....++.|+|+| +++++.++.+.+|++.. .+..
T Consensus 331 l~~~~--~~~~~SpDG~~ia~~~~~~-i~~~Dl~~g~~~~lt~~~~~~~~~~sPdG~~i~~~s~~g~~~~l~~~~~~G~~ 407 (429)
T PRK01742 331 VGGRG--YSAQISADGKTLVMINGDN-VVKQDLTSGSTEVLSSTFLDESPSISPNGIMIIYSSTQGLGKVLQLVSADGRF 407 (429)
T ss_pred ecCCC--CCccCCCCCCEEEEEcCCC-EEEEECCCCCeEEecCCCCCCCceECCCCCEEEEEEcCCCceEEEEEECCCCc
Confidence 24444 4678999999998887765 566999888654322 2234678899999 66667778777776432 2344
Q ss_pred ccccccccCCCCcceeEEEEccC
Q 040274 182 YSRYMGNSMVKGYQIGKVSFRPY 204 (359)
Q Consensus 182 ~~~~~~~~~~~~~~v~~~~~sp~ 204 (359)
...+..|.+ .+..++|+|.
T Consensus 408 ~~~l~~~~g----~~~~p~wsp~ 426 (429)
T PRK01742 408 KARLPGSDG----QVKFPAWSPY 426 (429)
T ss_pred eEEccCCCC----CCCCcccCCC
Confidence 555555533 6888999985
No 215
>KOG1524 consensus WD40 repeat-containing protein CHE-2 [General function prediction only]
Probab=99.24 E-value=1.9e-10 Score=105.04 Aligned_cols=150 Identities=16% Similarity=0.216 Sum_probs=106.5
Q ss_pred ECCCCCEEEEecc------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCE
Q 040274 56 LPSSGRYMAVAGR------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHL 123 (359)
Q Consensus 56 ~spdg~~l~~~~~------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~ 123 (359)
.+.||++.+..-. .+.|-.|+|+|.-|++++.||.|.+|.- +|-...++.-...+|.|++|.|+.+.
T Consensus 81 ~s~DGkf~il~k~~rVE~sv~AH~~A~~~gRW~~dGtgLlt~GEDG~iKiWSr-sGMLRStl~Q~~~~v~c~~W~p~S~~ 159 (737)
T KOG1524|consen 81 CSNDGRFVILNKSARVERSISAHAAAISSGRWSPDGAGLLTAGEDGVIKIWSR-SGMLRSTVVQNEESIRCARWAPNSNS 159 (737)
T ss_pred EcCCceEEEecccchhhhhhhhhhhhhhhcccCCCCceeeeecCCceEEEEec-cchHHHHHhhcCceeEEEEECCCCCc
Confidence 3567777665332 7899999999999999999999999984 45444445456778999999998777
Q ss_pred EEEecCCCeEEEEEcCCCeeeEee---cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeE
Q 040274 124 MATTGKECKIKIWDLRKYEVLQTL---TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGK 198 (359)
Q Consensus 124 l~s~~~d~~i~vwd~~~~~~~~~~---~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~ 198 (359)
++.|.. +.+.+=-+.....+..+ .|-|.+++|++.. ++++|.|-...||| ..+ ..+..... +..+|++
T Consensus 160 vl~c~g-~h~~IKpL~~n~k~i~WkAHDGiiL~~~W~~~s~lI~sgGED~kfKvWD-~~G-~~Lf~S~~----~ey~ITS 232 (737)
T KOG1524|consen 160 IVFCQG-GHISIKPLAANSKIIRWRAHDGLVLSLSWSTQSNIIASGGEDFRFKIWD-AQG-ANLFTSAA----EEYAITS 232 (737)
T ss_pred eEEecC-CeEEEeecccccceeEEeccCcEEEEeecCccccceeecCCceeEEeec-ccC-cccccCCh----hccceee
Confidence 665533 44555555544444444 4558999999987 78888999999999 343 22222222 4458999
Q ss_pred EEEccCCCEEEEEeCC
Q 040274 199 VSFRPYEDVLGIGHSM 214 (359)
Q Consensus 199 ~~~sp~~~~l~~g~~d 214 (359)
++|.|+ ..++.|+.+
T Consensus 233 va~npd-~~~~v~S~n 247 (737)
T KOG1524|consen 233 VAFNPE-KDYLLWSYN 247 (737)
T ss_pred eeeccc-cceeeeeee
Confidence 999999 445555543
No 216
>KOG1963 consensus WD40 repeat protein [General function prediction only]
Probab=99.23 E-value=9.4e-10 Score=105.86 Aligned_cols=154 Identities=17% Similarity=0.231 Sum_probs=116.9
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCC----CcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCe--
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTT----SALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYE-- 142 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~----~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~-- 142 (359)
.++|.++||.+.++++|..||.|.+|.--. ......+..|...|++++|+++|.+|++||..|.+.+|.+.+++
T Consensus 207 ~~t~~~~spn~~~~Aa~d~dGrI~vw~d~~~~~~~~t~t~lHWH~~~V~~L~fS~~G~~LlSGG~E~VLv~Wq~~T~~kq 286 (792)
T KOG1963|consen 207 NITCVALSPNERYLAAGDSDGRILVWRDFGSSDDSETCTLLHWHHDEVNSLSFSSDGAYLLSGGREGVLVLWQLETGKKQ 286 (792)
T ss_pred cceeEEeccccceEEEeccCCcEEEEeccccccccccceEEEecccccceeEEecCCceEeecccceEEEEEeecCCCcc
Confidence 679999999999999999999999996322 12345677899999999999999999999999999999999876
Q ss_pred eeEeecCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccc--------cCCCCcceeEEEEccCCCEEEEEe
Q 040274 143 VLQTLTGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGN--------SMVKGYQIGKVSFRPYEDVLGIGH 212 (359)
Q Consensus 143 ~~~~~~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~--------~~~~~~~v~~~~~sp~~~~l~~g~ 212 (359)
.+-.+.++|..+.+|||+ +..+..|+.|.+....+. .....+.+. .+ ...-.+.++++|.-+.++..+
T Consensus 287 fLPRLgs~I~~i~vS~ds~~~sl~~~DNqI~li~~~dl-~~k~tIsgi~~~~~~~k~~-~~~l~t~~~idpr~~~~vln~ 364 (792)
T KOG1963|consen 287 FLPRLGSPILHIVVSPDSDLYSLVLEDNQIHLIKASDL-EIKSTISGIKPPTPSTKTR-PQSLTTGVSIDPRTNSLVLNG 364 (792)
T ss_pred cccccCCeeEEEEEcCCCCeEEEEecCceEEEEeccch-hhhhhccCccCCCcccccc-ccccceeEEEcCCCCceeecC
Confidence 233446789999999999 555667999998875332 111111111 11 223467788999777788888
Q ss_pred CCCeEEEEEcCC
Q 040274 213 SMGWSGILVPRS 224 (359)
Q Consensus 213 ~dg~~~i~~~gs 224 (359)
..|.+.+|..-+
T Consensus 365 ~~g~vQ~ydl~t 376 (792)
T KOG1963|consen 365 HPGHVQFYDLYT 376 (792)
T ss_pred CCceEEEEeccc
Confidence 888888876544
No 217
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=99.23 E-value=8.4e-10 Score=104.49 Aligned_cols=156 Identities=15% Similarity=0.142 Sum_probs=106.2
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCCCCEEEE-EeCCC--eEEEEeCCCCcceE
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPFNGVVSL-GHSGG--TVTMWKPTTSALLI 103 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~~~~l~t-g~~dg--~v~lwd~~~~~~~~ 103 (359)
++..|+|||++|+++.. .+.+++|+|+++.|+. .+.++ .|++||+.++.. .
T Consensus 193 ~~p~~Spdg~~la~~~~~~~~~~i~v~d~~~g~~~~~~~~~~~~~~~~~spDg~~l~~~~~~~~~~~i~~~d~~~~~~-~ 271 (417)
T TIGR02800 193 LSPAWSPDGQKLAYVSFESGKPEIYVQDLATGQREKVASFPGMNGAPAFSPDGSKLAVSLSKDGNPDIYVMDLDGKQL-T 271 (417)
T ss_pred ecccCCCCCCEEEEEEcCCCCcEEEEEECCCCCEEEeecCCCCccceEECCCCCEEEEEECCCCCccEEEEECCCCCE-E
Confidence 67789999999987642 3567899999987764 44444 588899887653 3
Q ss_pred EeecCCCCeEEEEEecCCCEEEEecCC-C--eEEEEEcCCCeeeEee--cCCceeEEEcCCC--cEEEEcCC---cEEEE
Q 040274 104 KMLYHQGPVSALAFHPNGHLMATTGKE-C--KIKIWDLRKYEVLQTL--TGHAKTLDFSQKG--LLAVGTGS---FAQIL 173 (359)
Q Consensus 104 ~~~~h~~~v~~l~~~p~g~~l~s~~~d-~--~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g--l~~~~~d~---~i~v~ 173 (359)
.+..+........|+|+|..|+.++.. + .|++||+.++...... ...+..+.|+|+| ++.++.++ .|.+|
T Consensus 272 ~l~~~~~~~~~~~~s~dg~~l~~~s~~~g~~~iy~~d~~~~~~~~l~~~~~~~~~~~~spdg~~i~~~~~~~~~~~i~~~ 351 (417)
T TIGR02800 272 RLTNGPGIDTEPSWSPDGKSIAFTSDRGGSPQIYMMDADGGEVRRLTFRGGYNASPSWSPDGDLIAFVHREGGGFNIAVM 351 (417)
T ss_pred ECCCCCCCCCCEEECCCCCEEEEEECCCCCceEEEEECCCCCEEEeecCCCCccCeEECCCCCEEEEEEccCCceEEEEE
Confidence 444555556678999999988766543 2 6888898876543222 3346788999999 45555444 78888
Q ss_pred cCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 174 GDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 174 d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
|+.... ...+.... ......|+|+|.+|+.++.++
T Consensus 352 d~~~~~--~~~l~~~~-----~~~~p~~spdg~~l~~~~~~~ 386 (417)
T TIGR02800 352 DLDGGG--ERVLTDTG-----LDESPSFAPNGRMILYATTRG 386 (417)
T ss_pred eCCCCC--eEEccCCC-----CCCCceECCCCCEEEEEEeCC
Confidence 865432 22222221 245568999999988877755
No 218
>KOG1310 consensus WD40 repeat protein [General function prediction only]
Probab=99.22 E-value=2.5e-10 Score=104.53 Aligned_cols=175 Identities=18% Similarity=0.177 Sum_probs=125.8
Q ss_pred eEEEECCCCCEEEEecc------------------------ceeEEEEcC--CCCEEEEEeCCCeEEEEeCCC-------
Q 040274 52 ILWILPSSGRYMAVAGR------------------------RTDLMRVNP--FNGVVSLGHSGGTVTMWKPTT------- 98 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------~v~~l~~sp--~~~~l~tg~~dg~v~lwd~~~------- 98 (359)
.+|.|+.||.+|++|++ .|.|+.|-| .+.++++|..|..|+++|+..
T Consensus 54 N~LeWn~dG~lL~SGSDD~r~ivWd~~~~KllhsI~TgHtaNIFsvKFvP~tnnriv~sgAgDk~i~lfdl~~~~~~~~d 133 (758)
T KOG1310|consen 54 NCLEWNADGELLASGSDDTRLIVWDPFEYKLLHSISTGHTANIFSVKFVPYTNNRIVLSGAGDKLIKLFDLDSSKEGGMD 133 (758)
T ss_pred cceeecCCCCEEeecCCcceEEeecchhcceeeeeecccccceeEEeeeccCCCeEEEeccCcceEEEEecccccccccc
Confidence 99999999999999998 799999999 456899999999999999984
Q ss_pred ---CcceEEeecCCCCeEEEEEecCC-CEEEEecCCCeEEEEEcCCCee-------eEee----c--CCceeEEEcCCC-
Q 040274 99 ---SALLIKMLYHQGPVSALAFHPNG-HLMATTGKECKIKIWDLRKYEV-------LQTL----T--GHAKTLDFSQKG- 160 (359)
Q Consensus 99 ---~~~~~~~~~h~~~v~~l~~~p~g-~~l~s~~~d~~i~vwd~~~~~~-------~~~~----~--~~v~~~~~s~~g- 160 (359)
......+.+|...|-.++..|++ +.|.+++.||+|+-||++.... ...+ . -...|+.++|..
T Consensus 134 ~~~~~~~~~~~cht~rVKria~~p~~PhtfwsasEDGtirQyDiREph~c~p~~~~~~~l~ny~~~lielk~ltisp~rp 213 (758)
T KOG1310|consen 134 HGMEETTRCWSCHTDRVKRIATAPNGPHTFWSASEDGTIRQYDIREPHVCNPDEDCPSILVNYNPQLIELKCLTISPSRP 213 (758)
T ss_pred cCccchhhhhhhhhhhhhheecCCCCCceEEEecCCcceeeecccCCccCCccccccHHHHHhchhhheeeeeeecCCCC
Confidence 23455677899999999999988 7899999999999999986321 1111 1 124789999987
Q ss_pred --cEEEEcCCcEEEEcCCCCCc-----------------cccc-cccccC-CCC------cceeEEEEccCCCEEEEEeC
Q 040274 161 --LLAVGTGSFAQILGDFSGSH-----------------NYSR-YMGNSM-VKG------YQIGKVSFRPYEDVLGIGHS 213 (359)
Q Consensus 161 --l~~~~~d~~i~v~d~~~~~~-----------------~~~~-~~~~~~-~~~------~~v~~~~~sp~~~~l~~g~~ 213 (359)
++.|+.|...++||.+...+ .+.. .++|.. ..+ ..++-+.|+|+|.-|++.-.
T Consensus 214 ~~laVGgsdpfarLYD~Rr~lks~~s~~~~~~~pp~~~~cv~yf~p~hlkn~~gn~~~~~~~~t~vtfnpNGtElLvs~~ 293 (758)
T KOG1310|consen 214 YYLAVGGSDPFARLYDRRRVLKSFRSDGTMNTCPPKDCRCVRYFSPGHLKNSQGNLDRYITCCTYVTFNPNGTELLVSWG 293 (758)
T ss_pred ceEEecCCCchhhhhhhhhhccCCCCCccccCCCCcccchhheecCccccCcccccccceeeeEEEEECCCCcEEEEeeC
Confidence 66677888999999322100 0000 111210 000 12566789999988877776
Q ss_pred CCeEEEEEcCCCC
Q 040274 214 MGWSGILVPRSSE 226 (359)
Q Consensus 214 dg~~~i~~~gs~~ 226 (359)
.-.+.++...-+.
T Consensus 294 gEhVYlfdvn~~~ 306 (758)
T KOG1310|consen 294 GEHVYLFDVNEDK 306 (758)
T ss_pred CeEEEEEeecCCC
Confidence 6666666544443
No 219
>COG2319 FOG: WD40 repeat [General function prediction only]
Probab=99.22 E-value=2.6e-09 Score=99.17 Aligned_cols=170 Identities=27% Similarity=0.421 Sum_probs=128.8
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEE-cCCCC-EEEEEeC-CCeEEEEeCCC-Ccce
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRV-NPFNG-VVSLGHS-GGTVTMWKPTT-SALL 102 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~-sp~~~-~l~tg~~-dg~v~lwd~~~-~~~~ 102 (359)
.++.+.+++..++.++. .+..+.+ ++++. +++..+. |+.+.+|++.. ....
T Consensus 69 ~~~~~~~~~~~~~~~~~d~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~d~~~~~~~~~~~~~~~ 148 (466)
T COG2319 69 TSIAFSPDGELLLSGSSDGTIKLWDLDNGEKLIKSLEGLHDSSVSKLALSSPDGNSILLASSSLDGTVKLWDLSTPGKLI 148 (466)
T ss_pred EEEEECCCCcEEEEecCCCcEEEEEcCCCceeEEEEeccCCCceeeEEEECCCcceEEeccCCCCccEEEEEecCCCeEE
Confidence 66666677776666552 2555666 77776 4555444 99999999998 6778
Q ss_pred EEeecCCCCeEEEEEecCCCEEEEecC-CCeEEEEEcCCCeeeEeec---CCceeEEEcCCC--cEEE-EcCCcEEEEcC
Q 040274 103 IKMLYHQGPVSALAFHPNGHLMATTGK-ECKIKIWDLRKYEVLQTLT---GHAKTLDFSQKG--LLAV-GTGSFAQILGD 175 (359)
Q Consensus 103 ~~~~~h~~~v~~l~~~p~g~~l~s~~~-d~~i~vwd~~~~~~~~~~~---~~v~~~~~s~~g--l~~~-~~d~~i~v~d~ 175 (359)
..+..|...|.+++|+|++.++++++. |+.+++|++..+..+..+. ..+.+++|+|++ ++++ +.|+.|.+||.
T Consensus 149 ~~~~~~~~~v~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~~~~~~~~~~~~~~d~~i~~wd~ 228 (466)
T COG2319 149 RTLEGHSESVTSLAFSPDGKLLASGSSLDGTIKLWDLRTGKPLSTLAGHTDPVSSLAFSPDGGLLIASGSSDGTIRLWDL 228 (466)
T ss_pred EEEecCcccEEEEEECCCCCEEEecCCCCCceEEEEcCCCceEEeeccCCCceEEEEEcCCcceEEEEecCCCcEEEEEC
Confidence 888899999999999999998888886 9999999999877777774 468999999998 4444 78899999986
Q ss_pred CCCCcccc-ccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCCC
Q 040274 176 FSGSHNYS-RYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSEP 227 (359)
Q Consensus 176 ~~~~~~~~-~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~~ 227 (359)
... .... .+..|.. .+ ...|+|++.++++++.++.+.+|.......
T Consensus 229 ~~~-~~~~~~~~~~~~----~~-~~~~~~~~~~~~~~~~d~~~~~~~~~~~~~ 275 (466)
T COG2319 229 STG-KLLRSTLSGHSD----SV-VSSFSPDGSLLASGSSDGTIRLWDLRSSSS 275 (466)
T ss_pred CCC-cEEeeecCCCCc----ce-eEeECCCCCEEEEecCCCcEEEeeecCCCc
Confidence 522 3333 4555532 32 228999998999999999999987765544
No 220
>PRK02889 tolB translocation protein TolB; Provisional
Probab=99.19 E-value=1.7e-09 Score=102.56 Aligned_cols=141 Identities=18% Similarity=0.155 Sum_probs=91.3
Q ss_pred ceeEEEEcCCCCEEEEEeCC---CeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEE-EecCCCeEEEE--EcCCCe
Q 040274 69 RTDLMRVNPFNGVVSLGHSG---GTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMA-TTGKECKIKIW--DLRKYE 142 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~d---g~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~-s~~~d~~i~vw--d~~~~~ 142 (359)
.+.+.+|+|||+.|+.++.+ ..|.+||+.+++... +....+.+.++.|+|||+.|+ +.+.++...|| |+..+.
T Consensus 197 ~v~~p~wSPDG~~la~~s~~~~~~~I~~~dl~~g~~~~-l~~~~g~~~~~~~SPDG~~la~~~~~~g~~~Iy~~d~~~~~ 275 (427)
T PRK02889 197 PIISPAWSPDGTKLAYVSFESKKPVVYVHDLATGRRRV-VANFKGSNSAPAWSPDGRTLAVALSRDGNSQIYTVNADGSG 275 (427)
T ss_pred CcccceEcCCCCEEEEEEccCCCcEEEEEECCCCCEEE-eecCCCCccceEECCCCCEEEEEEccCCCceEEEEECCCCC
Confidence 78899999999998887643 369999999886543 333445667899999999876 46677765555 454443
Q ss_pred eeEee---cCCceeEEEcCCC--cEEEEc-CCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 143 VLQTL---TGHAKTLDFSQKG--LLAVGT-GSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 143 ~~~~~---~~~v~~~~~s~~g--l~~~~~-d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
+..+ .+...++.|+||| ++.++. ++...||.+.........+... +.......|+|||++|+..+.++
T Consensus 276 -~~~lt~~~~~~~~~~wSpDG~~l~f~s~~~g~~~Iy~~~~~~g~~~~lt~~----g~~~~~~~~SpDG~~Ia~~s~~~ 349 (427)
T PRK02889 276 -LRRLTQSSGIDTEPFFSPDGRSIYFTSDRGGAPQIYRMPASGGAAQRVTFT----GSYNTSPRISPDGKLLAYISRVG 349 (427)
T ss_pred -cEECCCCCCCCcCeEEcCCCCEEEEEecCCCCcEEEEEECCCCceEEEecC----CCCcCceEECCCCCEEEEEEccC
Confidence 3333 2345778999999 444443 4556666532221122222111 11345678999999998777554
No 221
>KOG4497 consensus Uncharacterized conserved protein WDR8, contains WD repeats [General function prediction only]
Probab=99.19 E-value=9.1e-10 Score=95.08 Aligned_cols=166 Identities=14% Similarity=0.170 Sum_probs=119.9
Q ss_pred eEEEECCCCCEEEEecc-------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcc-----------------
Q 040274 52 ILWILPSSGRYMAVAGR-------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSAL----------------- 101 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~----------------- 101 (359)
..+.|+|||..|+.-.. .+-.+.|+|.+++|+.|+.|+.+++.+--+.++
T Consensus 182 tgieWsPdg~~laVwd~~Leykv~aYe~~lG~k~v~wsP~~qflavGsyD~~lrvlnh~tWk~f~eflhl~s~~dp~~~~ 261 (447)
T KOG4497|consen 182 TGIEWSPDGNWLAVWDNVLEYKVYAYERGLGLKFVEWSPCNQFLAVGSYDQMLRVLNHFTWKPFGEFLHLCSYHDPTLHL 261 (447)
T ss_pred cCceECCCCcEEEEecchhhheeeeeeeccceeEEEeccccceEEeeccchhhhhhceeeeeehhhhccchhccCchhhh
Confidence 88999999999987544 788999999999999999999887754211100
Q ss_pred -------------------------------------------eEEee------cCCCCeEEEEEecCCCEEEEecCC--
Q 040274 102 -------------------------------------------LIKML------YHQGPVSALAFHPNGHLMATTGKE-- 130 (359)
Q Consensus 102 -------------------------------------------~~~~~------~h~~~v~~l~~~p~g~~l~s~~~d-- 130 (359)
+..++ ...-.+.-++|++|..+++|-...
T Consensus 262 ~~ke~~~~~ql~~~cLsf~p~~~~a~~~~~se~~YE~~~~pv~~~~lkp~tD~pnPk~g~g~lafs~Ds~y~aTrnd~~P 341 (447)
T KOG4497|consen 262 LEKETFSIVQLLHHCLSFTPTDLEAHIWEESETIYEQQMTPVKVHKLKPPTDFPNPKCGAGKLAFSCDSTYAATRNDKYP 341 (447)
T ss_pred hhhhhcchhhhcccccccCCCccccCccccchhhhhhhhcceeeecccCCCCCCCcccccceeeecCCceEEeeecCCCC
Confidence 00000 011235668999999998886543
Q ss_pred CeEEEEEcCCCeeeEee--cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCC
Q 040274 131 CKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYED 206 (359)
Q Consensus 131 ~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~ 206 (359)
+.+.+||++..+....+ ..+|....|+|.. ++.+.....+++|..........+. .|..|..+.|.-+|.
T Consensus 342 nalW~Wdlq~l~l~avLiQk~piraf~WdP~~prL~vctg~srLY~W~psg~~~V~vP~------~GF~i~~l~W~~~g~ 415 (447)
T KOG4497|consen 342 NALWLWDLQNLKLHAVLIQKHPIRAFEWDPGRPRLVVCTGKSRLYFWAPSGPRVVGVPK------KGFNIQKLQWLQPGE 415 (447)
T ss_pred ceEEEEechhhhhhhhhhhccceeEEEeCCCCceEEEEcCCceEEEEcCCCceEEecCC------CCceeeeEEecCCCc
Confidence 67999999987654444 6789999999988 7777777789999743321111122 334799999999999
Q ss_pred EEEEEeCCCeEEEEEcC
Q 040274 207 VLGIGHSMGWSGILVPR 223 (359)
Q Consensus 207 ~l~~g~~dg~~~i~~~g 223 (359)
+++..+.|.+..-++..
T Consensus 416 ~i~l~~kDafc~a~ve~ 432 (447)
T KOG4497|consen 416 FIVLCGKDAFCVAIVED 432 (447)
T ss_pred EEEEEcCCceEEEEecC
Confidence 99999999876665543
No 222
>PRK03629 tolB translocation protein TolB; Provisional
Probab=99.17 E-value=2.3e-09 Score=101.59 Aligned_cols=139 Identities=13% Similarity=0.044 Sum_probs=92.9
Q ss_pred ceeEEEEcCCCCEEEEEeC---CCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEe-cCCC--eEEEEEcCCCe
Q 040274 69 RTDLMRVNPFNGVVSLGHS---GGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATT-GKEC--KIKIWDLRKYE 142 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~---dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~-~~d~--~i~vwd~~~~~ 142 (359)
.+.+.+|||||+.|+..+. +..|.+|++.+++... +....+.+.++.|+|||+.|+.. +.++ .|++||+.++.
T Consensus 200 ~~~~p~wSPDG~~la~~s~~~g~~~i~i~dl~~G~~~~-l~~~~~~~~~~~~SPDG~~La~~~~~~g~~~I~~~d~~tg~ 278 (429)
T PRK03629 200 PLMSPAWSPDGSKLAYVTFESGRSALVIQTLANGAVRQ-VASFPRHNGAPAFSPDGSKLAFALSKTGSLNLYVMDLASGQ 278 (429)
T ss_pred ceeeeEEcCCCCEEEEEEecCCCcEEEEEECCCCCeEE-ccCCCCCcCCeEECCCCCEEEEEEcCCCCcEEEEEECCCCC
Confidence 6889999999998887652 3579999998876432 22233445678999999988765 4444 59999998876
Q ss_pred eeEee--cCCceeEEEcCCC--cEEEEc-CCc--EEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 143 VLQTL--TGHAKTLDFSQKG--LLAVGT-GSF--AQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 143 ~~~~~--~~~v~~~~~s~~g--l~~~~~-d~~--i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
..... ...+..+.|+||| ++.++. ++. |+++|+..+ ....+... +..+.+..|+|||++|+..+.+
T Consensus 279 ~~~lt~~~~~~~~~~wSPDG~~I~f~s~~~g~~~Iy~~d~~~g--~~~~lt~~----~~~~~~~~~SpDG~~Ia~~~~~ 351 (429)
T PRK03629 279 IRQVTDGRSNNTEPTWFPDSQNLAYTSDQAGRPQVYKVNINGG--APQRITWE----GSQNQDADVSSDGKFMVMVSSN 351 (429)
T ss_pred EEEccCCCCCcCceEECCCCCEEEEEeCCCCCceEEEEECCCC--CeEEeecC----CCCccCEEECCCCCEEEEEEcc
Confidence 54433 3356889999999 444443 344 444454332 22222222 1245678999999999876654
No 223
>KOG1272 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.16 E-value=6.2e-11 Score=106.36 Aligned_cols=143 Identities=12% Similarity=0.139 Sum_probs=117.4
Q ss_pred EEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee---c
Q 040274 72 LMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL---T 148 (359)
Q Consensus 72 ~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~---~ 148 (359)
.|.|-|..-+|++++..|.+..-|+.+|+.+..+....+.+..++-+|-...+-+|...|+|.+|...+.+++..+ .
T Consensus 214 rLeFLPyHfLL~~~~~~G~L~Y~DVS~GklVa~~~t~~G~~~vm~qNP~NaVih~GhsnGtVSlWSP~skePLvKiLcH~ 293 (545)
T KOG1272|consen 214 RLEFLPYHFLLVAASEAGFLKYQDVSTGKLVASIRTGAGRTDVMKQNPYNAVIHLGHSNGTVSLWSPNSKEPLVKILCHR 293 (545)
T ss_pred hhcccchhheeeecccCCceEEEeechhhhhHHHHccCCccchhhcCCccceEEEcCCCceEEecCCCCcchHHHHHhcC
Confidence 3678888888999999999999999999999999888899999999998889999999999999999988876655 7
Q ss_pred CCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEc
Q 040274 149 GHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVP 222 (359)
Q Consensus 149 ~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~ 222 (359)
++|.+|++.++| ++++|.|+.|.|||++... .+.++... . +...++||..| ++..+....+.||-.
T Consensus 294 g~V~siAv~~~G~YMaTtG~Dr~~kIWDlR~~~-ql~t~~tp-~----~a~~ls~Sqkg--lLA~~~G~~v~iw~d 361 (545)
T KOG1272|consen 294 GPVSSIAVDRGGRYMATTGLDRKVKIWDLRNFY-QLHTYRTP-H----PASNLSLSQKG--LLALSYGDHVQIWKD 361 (545)
T ss_pred CCcceEEECCCCcEEeecccccceeEeeecccc-ccceeecC-C----Ccccccccccc--ceeeecCCeeeeehh
Confidence 889999999999 8888999999999987765 33333332 1 56778887665 445555667788753
No 224
>PRK00178 tolB translocation protein TolB; Provisional
Probab=99.16 E-value=5.3e-09 Score=99.44 Aligned_cols=155 Identities=12% Similarity=0.063 Sum_probs=103.2
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCCCCEEEE-EeCCC--eEEEEeCCCCcceE
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPFNGVVSL-GHSGG--TVTMWKPTTSALLI 103 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~~~~l~t-g~~dg--~v~lwd~~~~~~~~ 103 (359)
.+..|||||++|++.+. .+.+..|+|+|..|+. .+.+| .|++||+.++.. .
T Consensus 202 ~~p~wSpDG~~la~~s~~~~~~~l~~~~l~~g~~~~l~~~~g~~~~~~~SpDG~~la~~~~~~g~~~Iy~~d~~~~~~-~ 280 (430)
T PRK00178 202 LSPRWSPDGKRIAYVSFEQKRPRIFVQNLDTGRREQITNFEGLNGAPAWSPDGSKLAFVLSKDGNPEIYVMDLASRQL-S 280 (430)
T ss_pred eeeeECCCCCEEEEEEcCCCCCEEEEEECCCCCEEEccCCCCCcCCeEECCCCCEEEEEEccCCCceEEEEECCCCCe-E
Confidence 67799999999987543 3446899999988764 44455 688889988764 3
Q ss_pred EeecCCCCeEEEEEecCCCEEEEecC-C--CeEEEEEcCCCeeeEe-ecC-CceeEEEcCCC--cEEEEc-CC--cEEEE
Q 040274 104 KMLYHQGPVSALAFHPNGHLMATTGK-E--CKIKIWDLRKYEVLQT-LTG-HAKTLDFSQKG--LLAVGT-GS--FAQIL 173 (359)
Q Consensus 104 ~~~~h~~~v~~l~~~p~g~~l~s~~~-d--~~i~vwd~~~~~~~~~-~~~-~v~~~~~s~~g--l~~~~~-d~--~i~v~ 173 (359)
.+..+........|+|||..|+..+. + ..|++||+.+++.... +.+ ......|+|+| ++..+. ++ .|.+|
T Consensus 281 ~lt~~~~~~~~~~~spDg~~i~f~s~~~g~~~iy~~d~~~g~~~~lt~~~~~~~~~~~Spdg~~i~~~~~~~~~~~l~~~ 360 (430)
T PRK00178 281 RVTNHPAIDTEPFWGKDGRTLYFTSDRGGKPQIYKVNVNGGRAERVTFVGNYNARPRLSADGKTLVMVHRQDGNFHVAAQ 360 (430)
T ss_pred EcccCCCCcCCeEECCCCCEEEEEECCCCCceEEEEECCCCCEEEeecCCCCccceEECCCCCEEEEEEccCCceEEEEE
Confidence 45556666778899999998766553 3 3688888887764332 222 24567899999 433333 23 57888
Q ss_pred cCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 174 GDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 174 d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
|+..+. . ..+ .... ......|+|+|++|+..+.+
T Consensus 361 dl~tg~-~-~~l-t~~~----~~~~p~~spdg~~i~~~~~~ 394 (430)
T PRK00178 361 DLQRGS-V-RIL-TDTS----LDESPSVAPNGTMLIYATRQ 394 (430)
T ss_pred ECCCCC-E-EEc-cCCC----CCCCceECCCCCEEEEEEec
Confidence 865542 2 222 1111 23356899999998877654
No 225
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=99.15 E-value=7.9e-10 Score=91.74 Aligned_cols=144 Identities=16% Similarity=0.195 Sum_probs=107.8
Q ss_pred eeEEEEcCCCCEEEEEeCCCeEEEEeCCC----------CcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcC
Q 040274 70 TDLMRVNPFNGVVSLGHSGGTVTMWKPTT----------SALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLR 139 (359)
Q Consensus 70 v~~l~~sp~~~~l~tg~~dg~v~lwd~~~----------~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~ 139 (359)
|.+-+|+|.+++|++|+.+|.|-+..+.+ ..++..+.+|.++|+.++|+. .+|++|+ ||.|+-|.-+
T Consensus 13 vf~qa~sp~~~~l~agn~~G~iav~sl~sl~s~sa~~~gk~~iv~eqahdgpiy~~~f~d--~~Lls~g-dG~V~gw~W~ 89 (325)
T KOG0649|consen 13 VFAQAISPSKQYLFAGNLFGDIAVLSLKSLDSGSAEPPGKLKIVPEQAHDGPIYYLAFHD--DFLLSGG-DGLVYGWEWN 89 (325)
T ss_pred HHHHhhCCcceEEEEecCCCeEEEEEehhhhccccCCCCCcceeeccccCCCeeeeeeeh--hheeecc-CceEEEeeeh
Confidence 45567888888999999999999988753 234566789999999999983 3566665 4999998754
Q ss_pred CCe------eeEee--c--------CCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEE
Q 040274 140 KYE------VLQTL--T--------GHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSF 201 (359)
Q Consensus 140 ~~~------~~~~~--~--------~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~ 201 (359)
... .+... + ..|+++...|.. ++.++.|+.++.||+.++ .....|.+|.. -|.++.-
T Consensus 90 E~~es~~~K~lwe~~~P~~~~~~evPeINam~ldP~enSi~~AgGD~~~y~~dlE~G-~i~r~~rGHtD----YvH~vv~ 164 (325)
T KOG0649|consen 90 EEEESLATKRLWEVKIPMQVDAVEVPEINAMWLDPSENSILFAGGDGVIYQVDLEDG-RIQREYRGHTD----YVHSVVG 164 (325)
T ss_pred hhhhhccchhhhhhcCccccCcccCCccceeEeccCCCcEEEecCCeEEEEEEecCC-EEEEEEcCCcc----eeeeeee
Confidence 321 11111 1 136888888765 777779999999997655 78888888865 6888887
Q ss_pred ccCCCEEEEEeCCCeEEEEE
Q 040274 202 RPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 202 sp~~~~l~~g~~dg~~~i~~ 221 (359)
-.....+++|+.||.+++|.
T Consensus 165 R~~~~qilsG~EDGtvRvWd 184 (325)
T KOG0649|consen 165 RNANGQILSGAEDGTVRVWD 184 (325)
T ss_pred cccCcceeecCCCccEEEEe
Confidence 66667799999999999854
No 226
>KOG0771 consensus Prolactin regulatory element-binding protein/Protein transport protein SEC12p [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.15 E-value=6.3e-10 Score=98.89 Aligned_cols=124 Identities=19% Similarity=0.288 Sum_probs=102.3
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee--
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML-- 106 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~-- 106 (359)
-+++|+.||..|++|+. .|.+|.|+|||.+|++-+.| ..+||+.+++.++....
T Consensus 148 k~vaf~~~gs~latgg~dg~lRv~~~Ps~~t~l~e~~~~~eV~DL~FS~dgk~lasig~d-~~~VW~~~~g~~~a~~t~~ 226 (398)
T KOG0771|consen 148 KVVAFNGDGSKLATGGTDGTLRVWEWPSMLTILEEIAHHAEVKDLDFSPDGKFLASIGAD-SARVWSVNTGAALARKTPF 226 (398)
T ss_pred eEEEEcCCCCEeeeccccceEEEEecCcchhhhhhHhhcCccccceeCCCCcEEEEecCC-ceEEEEeccCchhhhcCCc
Confidence 89999999999999976 89999999999999999999 99999998772111100
Q ss_pred ---------------------------------------cC-------------CCCeEEEEEecCCCEEEEecCCCeEE
Q 040274 107 ---------------------------------------YH-------------QGPVSALAFHPNGHLMATTGKECKIK 134 (359)
Q Consensus 107 ---------------------------------------~h-------------~~~v~~l~~~p~g~~l~s~~~d~~i~ 134 (359)
.+ ...|++++++++|++++.|+.||.|-
T Consensus 227 ~k~~~~~~cRF~~d~~~~~l~laa~~~~~~~v~~~~~~~w~~~~~l~~~~~~~~~~siSsl~VS~dGkf~AlGT~dGsVa 306 (398)
T KOG0771|consen 227 SKDEMFSSCRFSVDNAQETLRLAASQFPGGGVRLCDISLWSGSNFLRLRKKIKRFKSISSLAVSDDGKFLALGTMDGSVA 306 (398)
T ss_pred ccchhhhhceecccCCCceEEEEEecCCCCceeEEEeeeeccccccchhhhhhccCcceeEEEcCCCcEEEEeccCCcEE
Confidence 01 12688999999999999999999999
Q ss_pred EEEcCCCeeeEee----cCCceeEEEcCCC--cEEEEcCCcEEEEcCC
Q 040274 135 IWDLRKYEVLQTL----TGHAKTLDFSQKG--LLAVGTGSFAQILGDF 176 (359)
Q Consensus 135 vwd~~~~~~~~~~----~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~ 176 (359)
|++..+.+.++-. .+.|+.+.|+|+. +.+.+.+....|..+.
T Consensus 307 i~~~~~lq~~~~vk~aH~~~VT~ltF~Pdsr~~~svSs~~~~~v~~l~ 354 (398)
T KOG0771|consen 307 IYDAKSLQRLQYVKEAHLGFVTGLTFSPDSRYLASVSSDNEAAVTKLA 354 (398)
T ss_pred EEEeceeeeeEeehhhheeeeeeEEEcCCcCcccccccCCceeEEEEe
Confidence 9999988877766 2458999999998 7777888877777643
No 227
>PRK04922 tolB translocation protein TolB; Provisional
Probab=99.14 E-value=2.1e-09 Score=102.14 Aligned_cols=139 Identities=15% Similarity=0.153 Sum_probs=93.2
Q ss_pred ceeEEEEcCCCCEEEEEeCC---CeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEE-EecCCC--eEEEEEcCCCe
Q 040274 69 RTDLMRVNPFNGVVSLGHSG---GTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMA-TTGKEC--KIKIWDLRKYE 142 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~d---g~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~-s~~~d~--~i~vwd~~~~~ 142 (359)
.+.+.+|+|+|+.|++++.+ ..|++||+.++.... +..+.+...++.|+|||+.|+ +.+.++ .|++||+.++.
T Consensus 205 ~v~~p~wSpDg~~la~~s~~~~~~~l~~~dl~~g~~~~-l~~~~g~~~~~~~SpDG~~l~~~~s~~g~~~Iy~~d~~~g~ 283 (433)
T PRK04922 205 PILSPAWSPDGKKLAYVSFERGRSAIYVQDLATGQREL-VASFRGINGAPSFSPDGRRLALTLSRDGNPEIYVMDLGSRQ 283 (433)
T ss_pred ccccccCCCCCCEEEEEecCCCCcEEEEEECCCCCEEE-eccCCCCccCceECCCCCEEEEEEeCCCCceEEEEECCCCC
Confidence 68899999999998887743 469999998876533 334455566889999999775 445554 59999998876
Q ss_pred eeEee--cCCceeEEEcCCC--cEEEEc-CCc--EEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 143 VLQTL--TGHAKTLDFSQKG--LLAVGT-GSF--AQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 143 ~~~~~--~~~v~~~~~s~~g--l~~~~~-d~~--i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
..... .+....++|+||| ++.++. ++. |+++|+..+ . ...+... +....+++|+|+|++|+..+.+
T Consensus 284 ~~~lt~~~~~~~~~~~spDG~~l~f~sd~~g~~~iy~~dl~~g-~-~~~lt~~----g~~~~~~~~SpDG~~Ia~~~~~ 356 (433)
T PRK04922 284 LTRLTNHFGIDTEPTWAPDGKSIYFTSDRGGRPQIYRVAASGG-S-AERLTFQ----GNYNARASVSPDGKKIAMVHGS 356 (433)
T ss_pred eEECccCCCCccceEECCCCCEEEEEECCCCCceEEEEECCCC-C-eEEeecC----CCCccCEEECCCCCEEEEEECC
Confidence 53322 2334678999999 444443 344 666665433 2 2222211 1134578999999999876643
No 228
>KOG2321 consensus WD40 repeat protein [General function prediction only]
Probab=99.14 E-value=4.7e-10 Score=103.25 Aligned_cols=154 Identities=15% Similarity=0.139 Sum_probs=113.0
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee-
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL- 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~- 147 (359)
....|+++.-+.-|++++....|+-+++..|..+..|....+.++++..++...+|++|+.+|.|-.||.++...+.++
T Consensus 135 ~GRDm~y~~~scDly~~gsg~evYRlNLEqGrfL~P~~~~~~~lN~v~in~~hgLla~Gt~~g~VEfwDpR~ksrv~~l~ 214 (703)
T KOG2321|consen 135 FGRDMKYHKPSCDLYLVGSGSEVYRLNLEQGRFLNPFETDSGELNVVSINEEHGLLACGTEDGVVEFWDPRDKSRVGTLD 214 (703)
T ss_pred CCccccccCCCccEEEeecCcceEEEEccccccccccccccccceeeeecCccceEEecccCceEEEecchhhhhheeee
Confidence 4566777665555666666678999999999999999888899999999999999999999999999999986554444
Q ss_pred --------cC-----CceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCE-EEEE
Q 040274 148 --------TG-----HAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDV-LGIG 211 (359)
Q Consensus 148 --------~~-----~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~-l~~g 211 (359)
++ .|+++.|+.+| +.+|+..|.|.|||++........-.. ...+|..+.|.+.+.. -++.
T Consensus 215 ~~~~v~s~pg~~~~~svTal~F~d~gL~~aVGts~G~v~iyDLRa~~pl~~kdh~----~e~pi~~l~~~~~~~q~~v~S 290 (703)
T KOG2321|consen 215 AASSVNSHPGGDAAPSVTALKFRDDGLHVAVGTSTGSVLIYDLRASKPLLVKDHG----YELPIKKLDWQDTDQQNKVVS 290 (703)
T ss_pred cccccCCCccccccCcceEEEecCCceeEEeeccCCcEEEEEcccCCceeecccC----CccceeeecccccCCCceEEe
Confidence 11 28999999999 677778899999998776443333233 3348999999876322 2223
Q ss_pred eCCCeEEEEEcCCCC
Q 040274 212 HSMGWSGILVPRSSE 226 (359)
Q Consensus 212 ~~dg~~~i~~~gs~~ 226 (359)
....++.||...+|.
T Consensus 291 ~Dk~~~kiWd~~~Gk 305 (703)
T KOG2321|consen 291 MDKRILKIWDECTGK 305 (703)
T ss_pred cchHHhhhcccccCC
Confidence 334455666554443
No 229
>PRK05137 tolB translocation protein TolB; Provisional
Probab=99.14 E-value=2.8e-09 Score=101.43 Aligned_cols=139 Identities=13% Similarity=0.091 Sum_probs=96.8
Q ss_pred ceeEEEEcCCCCEEEEEeC---CCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEE-EecCCCe--EEEEEcCCCe
Q 040274 69 RTDLMRVNPFNGVVSLGHS---GGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMA-TTGKECK--IKIWDLRKYE 142 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~---dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~-s~~~d~~--i~vwd~~~~~ 142 (359)
.+.+.+|+|||+.|+..+. +..|.+||+.++... .+..+.+.+.+.+|+|||..|+ +.+.++. |++||+.++.
T Consensus 203 ~v~~p~wSpDG~~lay~s~~~g~~~i~~~dl~~g~~~-~l~~~~g~~~~~~~SPDG~~la~~~~~~g~~~Iy~~d~~~~~ 281 (435)
T PRK05137 203 LVLTPRFSPNRQEITYMSYANGRPRVYLLDLETGQRE-LVGNFPGMTFAPRFSPDGRKVVMSLSQGGNTDIYTMDLRSGT 281 (435)
T ss_pred CeEeeEECCCCCEEEEEEecCCCCEEEEEECCCCcEE-EeecCCCcccCcEECCCCCEEEEEEecCCCceEEEEECCCCc
Confidence 7899999999998888764 468999999887653 4445667788999999998765 4555554 8888998776
Q ss_pred eeEee--cCCceeEEEcCCC--cEEEEc-C--CcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 143 VLQTL--TGHAKTLDFSQKG--LLAVGT-G--SFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 143 ~~~~~--~~~v~~~~~s~~g--l~~~~~-d--~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
..... .+.....+|+||| ++.++. + ..|++||+... .. ..+.... ..+....|+|+|++|+..+.+
T Consensus 282 ~~~Lt~~~~~~~~~~~spDG~~i~f~s~~~g~~~Iy~~d~~g~-~~-~~lt~~~----~~~~~~~~SpdG~~ia~~~~~ 354 (435)
T PRK05137 282 TTRLTDSPAIDTSPSYSPDGSQIVFESDRSGSPQLYVMNADGS-NP-RRISFGG----GRYSTPVWSPRGDLIAFTKQG 354 (435)
T ss_pred eEEccCCCCccCceeEcCCCCEEEEEECCCCCCeEEEEECCCC-Ce-EEeecCC----CcccCeEECCCCCEEEEEEcC
Confidence 53322 3345779999999 444442 2 36788885432 22 2222221 146678999999999887653
No 230
>KOG1517 consensus Guanine nucleotide binding protein MIP1 [Cell cycle control, cell division, chromosome partitioning]
Probab=99.14 E-value=9.5e-10 Score=107.70 Aligned_cols=154 Identities=11% Similarity=0.173 Sum_probs=112.9
Q ss_pred eEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee-cCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCCCe---eeE
Q 040274 71 DLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML-YHQGPVSALAFHP-NGHLMATTGKECKIKIWDLRKYE---VLQ 145 (359)
Q Consensus 71 ~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~-~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~~~---~~~ 145 (359)
.-++|.....+|++++.-..|+|||......+..+. +...-|++++-+- .|+.++.|..||.|++||.|... .+.
T Consensus 1169 ~v~dWqQ~~G~Ll~tGd~r~IRIWDa~~E~~~~diP~~s~t~vTaLS~~~~~gn~i~AGfaDGsvRvyD~R~a~~ds~v~ 1248 (1387)
T KOG1517|consen 1169 LVVDWQQQSGHLLVTGDVRSIRIWDAHKEQVVADIPYGSSTLVTALSADLVHGNIIAAGFADGSVRVYDRRMAPPDSLVC 1248 (1387)
T ss_pred eeeehhhhCCeEEecCCeeEEEEEecccceeEeecccCCCccceeecccccCCceEEEeecCCceEEeecccCCccccce
Confidence 445677766667776667899999999877766655 3445677776543 57899999999999999998643 344
Q ss_pred ee---cC--CceeEEEcCCC---cEEEEcCCcEEEEcCCCC-CccccccccccCCCCcceeEEEEccCCCEEEEEeCCCe
Q 040274 146 TL---TG--HAKTLDFSQKG---LLAVGTGSFAQILGDFSG-SHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGW 216 (359)
Q Consensus 146 ~~---~~--~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~-~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~ 216 (359)
.+ .. +|..+.+.+.| +++++.+|.|++||++.. ......+..|.. .|+..+++..+++..++|+|+. +.
T Consensus 1249 ~~R~h~~~~~Iv~~slq~~G~~elvSgs~~G~I~~~DlR~~~~e~~~~iv~~~~-yGs~lTal~VH~hapiiAsGs~-q~ 1326 (1387)
T KOG1517|consen 1249 VYREHNDVEPIVHLSLQRQGLGELVSGSQDGDIQLLDLRMSSKETFLTIVAHWE-YGSALTALTVHEHAPIIASGSA-QL 1326 (1387)
T ss_pred eecccCCcccceeEEeecCCCcceeeeccCCeEEEEecccCcccccceeeeccc-cCccceeeeeccCCCeeeecCc-ce
Confidence 44 22 38888888877 999999999999998764 222222333321 3446999999999999999999 88
Q ss_pred EEEEEcCCCC
Q 040274 217 SGILVPRSSE 226 (359)
Q Consensus 217 ~~i~~~gs~~ 226 (359)
+.||......
T Consensus 1327 ikIy~~~G~~ 1336 (1387)
T KOG1517|consen 1327 IKIYSLSGEQ 1336 (1387)
T ss_pred EEEEecChhh
Confidence 8888765543
No 231
>KOG1963 consensus WD40 repeat protein [General function prediction only]
Probab=99.14 E-value=1.4e-09 Score=104.72 Aligned_cols=182 Identities=14% Similarity=0.183 Sum_probs=128.9
Q ss_pred eEEEECCCCCEEEEecc---------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEE
Q 040274 52 ILWILPSSGRYMAVAGR---------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIK 104 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~---------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~ 104 (359)
.+.++||+++++++|.. .|++++|+++|.+|++|+..|.+-+|.+.|++ ..-
T Consensus 209 t~~~~spn~~~~Aa~d~dGrI~vw~d~~~~~~~~t~t~lHWH~~~V~~L~fS~~G~~LlSGG~E~VLv~Wq~~T~~-kqf 287 (792)
T KOG1963|consen 209 TCVALSPNERYLAAGDSDGRILVWRDFGSSDDSETCTLLHWHHDEVNSLSFSSDGAYLLSGGREGVLVLWQLETGK-KQF 287 (792)
T ss_pred eeEEeccccceEEEeccCCcEEEEeccccccccccceEEEecccccceeEEecCCceEeecccceEEEEEeecCCC-ccc
Confidence 68899999999998765 89999999999999999999999999999987 333
Q ss_pred eecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee--------------cCCceeEEEcC-CC-cEEEEcCC
Q 040274 105 MLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL--------------TGHAKTLDFSQ-KG-LLAVGTGS 168 (359)
Q Consensus 105 ~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~--------------~~~v~~~~~s~-~g-l~~~~~d~ 168 (359)
+.--.++|..+.++||+.+.+....|+.|.+-.+.+.....++ .+-.+.++++| .+ ++..+..+
T Consensus 288 LPRLgs~I~~i~vS~ds~~~sl~~~DNqI~li~~~dl~~k~tIsgi~~~~~~~k~~~~~l~t~~~idpr~~~~vln~~~g 367 (792)
T KOG1963|consen 288 LPRLGSPILHIVVSPDSDLYSLVLEDNQIHLIKASDLEIKSTISGIKPPTPSTKTRPQSLTTGVSIDPRTNSLVLNGHPG 367 (792)
T ss_pred ccccCCeeEEEEEcCCCCeEEEEecCceEEEEeccchhhhhhccCccCCCccccccccccceeEEEcCCCCceeecCCCc
Confidence 4455789999999999999999999999999877654433333 12247788999 44 78888899
Q ss_pred cEEEEcCCCCCccccccc----cccC--CCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCCCceeeeccCC
Q 040274 169 FAQILGDFSGSHNYSRYM----GNSM--VKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSEPNFDSWVANP 236 (359)
Q Consensus 169 ~i~v~d~~~~~~~~~~~~----~~~~--~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~~~~~~~~~~~ 236 (359)
+|++||+.+......... .+.+ .....++.+..+-.|.+++++-.. +.......++..++.|..++
T Consensus 368 ~vQ~ydl~td~~i~~~~v~~~n~~~~~~n~~v~itav~~~~~gs~maT~E~~--~d~~~~~~~e~~LKFW~~n~ 439 (792)
T KOG1963|consen 368 HVQFYDLYTDSTIYKLQVCDENYSDGDVNIQVGITAVARSRFGSWMATLEAR--IDKFNFFDGEVSLKFWQYNP 439 (792)
T ss_pred eEEEEeccccceeeeEEEEeecccCCcceeEEeeeeehhhccceEEEEeeee--ehhhhccCceEEEEEEEEcC
Confidence 999999766533321110 0100 011247777888889998876432 11122222344455555444
No 232
>KOG0974 consensus WD-repeat protein WDR6, WD repeat superfamily [General function prediction only]
Probab=99.14 E-value=1.2e-09 Score=106.79 Aligned_cols=143 Identities=18% Similarity=0.278 Sum_probs=118.8
Q ss_pred EEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeE-ee---c
Q 040274 73 MRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQ-TL---T 148 (359)
Q Consensus 73 l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~-~~---~ 148 (359)
+.++++.-++++|+.-+.|.+|++.-......+.+|.+.+.++.|+-||++++++|.|.++++|++.+.+.+. +. .
T Consensus 139 ~g~s~~~~~i~~gsv~~~iivW~~~~dn~p~~l~GHeG~iF~i~~s~dg~~i~s~SdDRsiRlW~i~s~~~~~~~~fgHs 218 (967)
T KOG0974|consen 139 IGDSAEELYIASGSVFGEIIVWKPHEDNKPIRLKGHEGSIFSIVTSLDGRYIASVSDDRSIRLWPIDSREVLGCTGFGHS 218 (967)
T ss_pred EeccCcEEEEEeccccccEEEEeccccCCcceecccCCceEEEEEccCCcEEEEEecCcceeeeecccccccCccccccc
Confidence 3446667789999999999999988444344578999999999999999999999999999999999877654 22 4
Q ss_pred CCceeEEEcCCCcEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEE
Q 040274 149 GHAKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGIL 220 (359)
Q Consensus 149 ~~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~ 220 (359)
..++.++|.|+-+++++.|.++++|+. +. .....|..| .+..|..++..++..++++++.||.+.+|
T Consensus 219 aRvw~~~~~~n~i~t~gedctcrvW~~-~~-~~l~~y~~h---~g~~iw~~~~~~~~~~~vT~g~Ds~lk~~ 285 (967)
T KOG0974|consen 219 ARVWACCFLPNRIITVGEDCTCRVWGV-NG-TQLEVYDEH---SGKGIWKIAVPIGVIIKVTGGNDSTLKLW 285 (967)
T ss_pred ceeEEEEeccceeEEeccceEEEEEec-cc-ceehhhhhh---hhcceeEEEEcCCceEEEeeccCcchhhh
Confidence 568999999998999999999999963 33 456688888 34579999999999999999999987764
No 233
>KOG3881 consensus Uncharacterized conserved protein [Function unknown]
Probab=99.13 E-value=1.3e-09 Score=96.03 Aligned_cols=130 Identities=15% Similarity=0.206 Sum_probs=109.0
Q ss_pred ceeEEEEcCC--CCEEEEEeCCCeEEEEeCCCC-cceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeE
Q 040274 69 RTDLMRVNPF--NGVVSLGHSGGTVTMWKPTTS-ALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQ 145 (359)
Q Consensus 69 ~v~~l~~sp~--~~~l~tg~~dg~v~lwd~~~~-~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~ 145 (359)
.++++.|-+. +..|++++.-+.|++||+..+ .|+..|.-...+++++...|+|+++++|...+.+..||++.+..+.
T Consensus 204 W~tdi~Fl~g~~~~~fat~T~~hqvR~YDt~~qRRPV~~fd~~E~~is~~~l~p~gn~Iy~gn~~g~l~~FD~r~~kl~g 283 (412)
T KOG3881|consen 204 WITDIRFLEGSPNYKFATITRYHQVRLYDTRHQRRPVAQFDFLENPISSTGLTPSGNFIYTGNTKGQLAKFDLRGGKLLG 283 (412)
T ss_pred eeccceecCCCCCceEEEEecceeEEEecCcccCcceeEeccccCcceeeeecCCCcEEEEecccchhheecccCceeec
Confidence 6788999886 789999999999999999866 6788888788999999999999999999999999999999988755
Q ss_pred e-e---cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccC
Q 040274 146 T-L---TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPY 204 (359)
Q Consensus 146 ~-~---~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~ 204 (359)
. + .|.++++..+|.+ ++++|-|+.|+|||+.+..-....|... .++++.+.++
T Consensus 284 ~~~kg~tGsirsih~hp~~~~las~GLDRyvRIhD~ktrkll~kvYvKs------~lt~il~~~~ 342 (412)
T KOG3881|consen 284 CGLKGITGSIRSIHCHPTHPVLASCGLDRYVRIHDIKTRKLLHKVYVKS------RLTFILLRDD 342 (412)
T ss_pred cccCCccCCcceEEEcCCCceEEeeccceeEEEeecccchhhhhhhhhc------cccEEEecCC
Confidence 5 3 6789999999998 7788899999999976643344444433 5777777665
No 234
>KOG0280 consensus Uncharacterized conserved protein [Amino acid transport and metabolism]
Probab=99.12 E-value=1.5e-09 Score=92.41 Aligned_cols=175 Identities=15% Similarity=0.122 Sum_probs=122.4
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcC-CCCEEEEEeCCCeEEEEeCC-CCcceEE
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNP-FNGVVSLGHSGGTVTMWKPT-TSALLIK 104 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~-~~~~~~~ 104 (359)
.++.|++.|..++++-. .++-..|+. +.+++++|+.||.+.-||++ .++.+..
T Consensus 125 lslD~~~~~~~i~vs~s~G~~~~v~~t~~~le~vq~wk~He~E~Wta~f~~~~pnlvytGgDD~~l~~~D~R~p~~~i~~ 204 (339)
T KOG0280|consen 125 LSLDISTSGTKIFVSDSRGSISGVYETEMVLEKVQTWKVHEFEAWTAKFSDKEPNLVYTGGDDGSLSCWDIRIPKTFIWH 204 (339)
T ss_pred eEEEeeccCceEEEEcCCCcEEEEecceeeeeecccccccceeeeeeecccCCCceEEecCCCceEEEEEecCCcceeee
Confidence 67788877777665433 667777877 55789999999999999999 3344444
Q ss_pred -eecCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcC-CCeeeEee--cCCceeEEEcCCC---cEEEEcCCcEEEEcCC
Q 040274 105 -MLYHQGPVSALAFHP-NGHLMATTGKECKIKIWDLR-KYEVLQTL--TGHAKTLDFSQKG---LLAVGTGSFAQILGDF 176 (359)
Q Consensus 105 -~~~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~-~~~~~~~~--~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~ 176 (359)
..-|...|.++.-+| .+.+++||+.|-.|++||.| .++++..- .|.|+.+.++|.- +++++.-+...|.++.
T Consensus 205 n~kvH~~GV~SI~ss~~~~~~I~TGsYDe~i~~~DtRnm~kPl~~~~v~GGVWRi~~~p~~~~~lL~~CMh~G~ki~~~~ 284 (339)
T KOG0280|consen 205 NSKVHTSGVVSIYSSPPKPTYIATGSYDECIRVLDTRNMGKPLFKAKVGGGVWRIKHHPEIFHRLLAACMHNGAKILDSS 284 (339)
T ss_pred cceeeecceEEEecCCCCCceEEEeccccceeeeehhcccCccccCccccceEEEEecchhhhHHHHHHHhcCceEEEec
Confidence 457889999998877 68899999999999999999 47777655 6789999999975 5666655555666543
Q ss_pred CCCcc-ccccccccCCCCcceeEEEEccCCCEEEEEeC-CCe-EEEEEcCCCCC
Q 040274 177 SGSHN-YSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHS-MGW-SGILVPRSSEP 227 (359)
Q Consensus 177 ~~~~~-~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~-dg~-~~i~~~gs~~~ 227 (359)
..... ...+..+.. |.+.+..-.|.....+|++++. |.. ..+|..+++.+
T Consensus 285 ~~~~e~~~~~~s~~~-hdSl~YG~DWd~~~~~lATCsFYDk~~~~~Wl~~t~~~ 337 (339)
T KOG0280|consen 285 DKVLEFQIVLPSDKI-HDSLCYGGDWDSKDSFLATCSFYDKKIRQLWLHITGEP 337 (339)
T ss_pred ccccchheeeecccc-ccceeeccccccccceeeeeeccccceeeeeeeccCCc
Confidence 33211 112233333 3345666777665567887553 444 34777776654
No 235
>PRK01029 tolB translocation protein TolB; Provisional
Probab=99.12 E-value=6.8e-09 Score=98.18 Aligned_cols=139 Identities=12% Similarity=0.065 Sum_probs=84.0
Q ss_pred ceeEEEEcCCCCEEEEEeC-CC----eEEEEeCCCC---cceEEeecCCCCeEEEEEecCCCEEEEec-CCCe--EEEEE
Q 040274 69 RTDLMRVNPFNGVVSLGHS-GG----TVTMWKPTTS---ALLIKMLYHQGPVSALAFHPNGHLMATTG-KECK--IKIWD 137 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~-dg----~v~lwd~~~~---~~~~~~~~h~~~v~~l~~~p~g~~l~s~~-~d~~--i~vwd 137 (359)
.....+|||||+.|+..+. +| .+.+|++.++ ........+.+.....+|+|||+.|+..+ .+|. |++++
T Consensus 232 ~~~~p~wSPDG~~Laf~s~~~g~~di~~~~~~~~~g~~g~~~~lt~~~~~~~~~p~wSPDG~~Laf~s~~~g~~~ly~~~ 311 (428)
T PRK01029 232 NQLMPTFSPRKKLLAFISDRYGNPDLFIQSFSLETGAIGKPRRLLNEAFGTQGNPSFSPDGTRLVFVSNKDGRPRIYIMQ 311 (428)
T ss_pred CccceEECCCCCEEEEEECCCCCcceeEEEeecccCCCCcceEeecCCCCCcCCeEECCCCCEEEEEECCCCCceEEEEE
Confidence 3456789999988877653 23 3445776653 33333323334557789999999877655 4564 55555
Q ss_pred cCC-CeeeEee---cCCceeEEEcCCC--cEEEEcC---CcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEE
Q 040274 138 LRK-YEVLQTL---TGHAKTLDFSQKG--LLAVGTG---SFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVL 208 (359)
Q Consensus 138 ~~~-~~~~~~~---~~~v~~~~~s~~g--l~~~~~d---~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l 208 (359)
+.. +.....+ .+.+....||||| ++.++.+ ..|.+||+..+ .. ..+.... ..+.+..|+|||+.|
T Consensus 312 ~~~~g~~~~~lt~~~~~~~~p~wSPDG~~Laf~~~~~g~~~I~v~dl~~g-~~-~~Lt~~~----~~~~~p~wSpDG~~L 385 (428)
T PRK01029 312 IDPEGQSPRLLTKKYRNSSCPAWSPDGKKIAFCSVIKGVRQICVYDLATG-RD-YQLTTSP----ENKESPSWAIDSLHL 385 (428)
T ss_pred CcccccceEEeccCCCCccceeECCCCCEEEEEEcCCCCcEEEEEECCCC-Ce-EEccCCC----CCccceEECCCCCEE
Confidence 542 2222222 3456789999999 4444432 46899996554 22 2222211 146778999999988
Q ss_pred EEEeC
Q 040274 209 GIGHS 213 (359)
Q Consensus 209 ~~g~~ 213 (359)
+..+.
T Consensus 386 ~f~~~ 390 (428)
T PRK01029 386 VYSAG 390 (428)
T ss_pred EEEEC
Confidence 76543
No 236
>KOG2315 consensus Predicted translation initiation factor related to eIF-3a [Translation, ribosomal structure and biogenesis]
Probab=99.11 E-value=4.3e-09 Score=96.80 Aligned_cols=140 Identities=16% Similarity=0.258 Sum_probs=101.1
Q ss_pred eeEEEEcCCCC-EEEEEeC--C---------CeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEE--ecCCCeEEE
Q 040274 70 TDLMRVNPFNG-VVSLGHS--G---------GTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMAT--TGKECKIKI 135 (359)
Q Consensus 70 v~~l~~sp~~~-~l~tg~~--d---------g~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s--~~~d~~i~v 135 (359)
=..|.|++-|. +|+.++. | .+++++++....+...+ ...++|+++.|+|+|+-|+. |-+--.+.|
T Consensus 220 kvqm~WN~~gt~LLvLastdVDktn~SYYGEq~Lyll~t~g~s~~V~L-~k~GPVhdv~W~~s~~EF~VvyGfMPAkvti 298 (566)
T KOG2315|consen 220 KVQMKWNKLGTALLVLASTDVDKTNASYYGEQTLYLLATQGESVSVPL-LKEGPVHDVTWSPSGREFAVVYGFMPAKVTI 298 (566)
T ss_pred eeEEEeccCCceEEEEEEEeecCCCccccccceEEEEEecCceEEEec-CCCCCceEEEECCCCCEEEEEEecccceEEE
Confidence 34677888554 4444332 2 35888888744544444 34899999999999987655 445678999
Q ss_pred EEcCCCeeeEee-cCCceeEEEcCCC--cEEEEcC---CcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEE
Q 040274 136 WDLRKYEVLQTL-TGHAKTLDFSQKG--LLAVGTG---SFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLG 209 (359)
Q Consensus 136 wd~~~~~~~~~~-~~~v~~~~~s~~g--l~~~~~d---~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~ 209 (359)
||++ +.++..+ .++-+++-|+|.| ++.+|.+ |.+.|||+.+ .+.+..+... ..+-+.|+|||.+++
T Consensus 299 fnlr-~~~v~df~egpRN~~~fnp~g~ii~lAGFGNL~G~mEvwDv~n-~K~i~~~~a~------~tt~~eW~PdGe~fl 370 (566)
T KOG2315|consen 299 FNLR-GKPVFDFPEGPRNTAFFNPHGNIILLAGFGNLPGDMEVWDVPN-RKLIAKFKAA------NTTVFEWSPDGEYFL 370 (566)
T ss_pred EcCC-CCEeEeCCCCCccceEECCCCCEEEEeecCCCCCceEEEeccc-hhhccccccC------CceEEEEcCCCcEEE
Confidence 9988 6788888 6788999999999 5666655 7999999766 3455444433 356689999999999
Q ss_pred EEeCCCeEE
Q 040274 210 IGHSMGWSG 218 (359)
Q Consensus 210 ~g~~dg~~~ 218 (359)
+++..-..+
T Consensus 371 TATTaPRlr 379 (566)
T KOG2315|consen 371 TATTAPRLR 379 (566)
T ss_pred EEeccccEE
Confidence 988764433
No 237
>PRK04792 tolB translocation protein TolB; Provisional
Probab=99.10 E-value=6.7e-09 Score=98.90 Aligned_cols=156 Identities=15% Similarity=0.134 Sum_probs=101.2
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCCCCEEEE-EeCCCe--EEEEeCCCCcceE
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPFNGVVSL-GHSGGT--VTMWKPTTSALLI 103 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~~~~l~t-g~~dg~--v~lwd~~~~~~~~ 103 (359)
.+..|||||++|+..+. ......|+|||+.|+. .+.+|. |++||+.+++. .
T Consensus 221 ~~p~wSPDG~~La~~s~~~g~~~L~~~dl~tg~~~~lt~~~g~~~~~~wSPDG~~La~~~~~~g~~~Iy~~dl~tg~~-~ 299 (448)
T PRK04792 221 MSPAWSPDGRKLAYVSFENRKAEIFVQDIYTQVREKVTSFPGINGAPRFSPDGKKLALVLSKDGQPEIYVVDIATKAL-T 299 (448)
T ss_pred cCceECCCCCEEEEEEecCCCcEEEEEECCCCCeEEecCCCCCcCCeeECCCCCEEEEEEeCCCCeEEEEEECCCCCe-E
Confidence 57899999999987542 2356899999997765 455664 77888887754 4
Q ss_pred EeecCCCCeEEEEEecCCCEEEEecC-C--CeEEEEEcCCCeeeEe-ecC-CceeEEEcCCC--cEEEEc-CC--cEEEE
Q 040274 104 KMLYHQGPVSALAFHPNGHLMATTGK-E--CKIKIWDLRKYEVLQT-LTG-HAKTLDFSQKG--LLAVGT-GS--FAQIL 173 (359)
Q Consensus 104 ~~~~h~~~v~~l~~~p~g~~l~s~~~-d--~~i~vwd~~~~~~~~~-~~~-~v~~~~~s~~g--l~~~~~-d~--~i~v~ 173 (359)
.+..+.......+|+|||+.|+..+. + ..|+++|+.+++.... +.+ .....+|+|+| ++..+. ++ .|.++
T Consensus 300 ~lt~~~~~~~~p~wSpDG~~I~f~s~~~g~~~Iy~~dl~~g~~~~Lt~~g~~~~~~~~SpDG~~l~~~~~~~g~~~I~~~ 379 (448)
T PRK04792 300 RITRHRAIDTEPSWHPDGKSLIFTSERGGKPQIYRVNLASGKVSRLTFEGEQNLGGSITPDGRSMIMVNRTNGKFNIARQ 379 (448)
T ss_pred ECccCCCCccceEECCCCCEEEEEECCCCCceEEEEECCCCCEEEEecCCCCCcCeeECCCCCEEEEEEecCCceEEEEE
Confidence 44455566788999999998776553 3 3577788877764332 222 24567999999 434333 34 45566
Q ss_pred cCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 174 GDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 174 d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
|+..+ .. ..+.... ......|+|+|+.|+..+.++
T Consensus 380 dl~~g-~~-~~lt~~~-----~d~~ps~spdG~~I~~~~~~~ 414 (448)
T PRK04792 380 DLETG-AM-QVLTSTR-----LDESPSVAPNGTMVIYSTTYQ 414 (448)
T ss_pred ECCCC-Ce-EEccCCC-----CCCCceECCCCCEEEEEEecC
Confidence 75443 22 2222111 223458999999887766543
No 238
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=99.07 E-value=6.1e-08 Score=89.31 Aligned_cols=171 Identities=15% Similarity=0.159 Sum_probs=109.2
Q ss_pred eEEEECCCCCEEEEecc--------------------------------------ceeEEEEcCCCCEEEEEeC-CCeEE
Q 040274 52 ILWILPSSGRYMAVAGR--------------------------------------RTDLMRVNPFNGVVSLGHS-GGTVT 92 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~--------------------------------------~v~~l~~sp~~~~l~tg~~-dg~v~ 92 (359)
..++++|+|++|+++.. ..+++.|+|+++++++... ...|.
T Consensus 90 ~~i~~~~~g~~l~vany~~g~v~v~~l~~~g~l~~~~~~~~~~g~g~~~~rq~~~h~H~v~~~pdg~~v~v~dlG~D~v~ 169 (345)
T PF10282_consen 90 CHIAVDPDGRFLYVANYGGGSVSVFPLDDDGSLGEVVQTVRHEGSGPNPDRQEGPHPHQVVFSPDGRFVYVPDLGADRVY 169 (345)
T ss_dssp EEEEECTTSSEEEEEETTTTEEEEEEECTTSEEEEEEEEEESEEEESSTTTTSSTCEEEEEE-TTSSEEEEEETTTTEEE
T ss_pred EEEEEecCCCEEEEEEccCCeEEEEEccCCcccceeeeecccCCCCCcccccccccceeEEECCCCCEEEEEecCCCEEE
Confidence 56888999999988754 3568999999998877653 45799
Q ss_pred EEeCCCCcc-e---EEee-cCCCCeEEEEEecCCCEEEEec-CCCeEEEEEcC--CCe--eeEee---c----C--Ccee
Q 040274 93 MWKPTTSAL-L---IKML-YHQGPVSALAFHPNGHLMATTG-KECKIKIWDLR--KYE--VLQTL---T----G--HAKT 153 (359)
Q Consensus 93 lwd~~~~~~-~---~~~~-~h~~~v~~l~~~p~g~~l~s~~-~d~~i~vwd~~--~~~--~~~~~---~----~--~v~~ 153 (359)
+|++..... + ..+. .....-..+.|+|++++++..+ .++.|.+|++. .+. .+..+ + + ....
T Consensus 170 ~~~~~~~~~~l~~~~~~~~~~G~GPRh~~f~pdg~~~Yv~~e~s~~v~v~~~~~~~g~~~~~~~~~~~~~~~~~~~~~~~ 249 (345)
T PF10282_consen 170 VYDIDDDTGKLTPVDSIKVPPGSGPRHLAFSPDGKYAYVVNELSNTVSVFDYDPSDGSLTEIQTISTLPEGFTGENAPAE 249 (345)
T ss_dssp EEEE-TTS-TEEEEEEEECSTTSSEEEEEE-TTSSEEEEEETTTTEEEEEEEETTTTEEEEEEEEESCETTSCSSSSEEE
T ss_pred EEEEeCCCceEEEeeccccccCCCCcEEEEcCCcCEEEEecCCCCcEEEEeecccCCceeEEEEeeeccccccccCCcee
Confidence 999876541 2 2222 2334568899999999876654 57889999988 443 23333 1 1 3578
Q ss_pred EEEcCCC-cEEEE--cCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeC-CCeEEEEEcC
Q 040274 154 LDFSQKG-LLAVG--TGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHS-MGWSGILVPR 223 (359)
Q Consensus 154 ~~~s~~g-l~~~~--~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~-dg~~~i~~~g 223 (359)
|.++||| ++.++ ..+.|.+|++......+........ .+.....+.++|+|++|+++.. ++.+.+|.-.
T Consensus 250 i~ispdg~~lyvsnr~~~sI~vf~~d~~~g~l~~~~~~~~-~G~~Pr~~~~s~~g~~l~Va~~~s~~v~vf~~d 322 (345)
T PF10282_consen 250 IAISPDGRFLYVSNRGSNSISVFDLDPATGTLTLVQTVPT-GGKFPRHFAFSPDGRYLYVANQDSNTVSVFDID 322 (345)
T ss_dssp EEE-TTSSEEEEEECTTTEEEEEEECTTTTTEEEEEEEEE-SSSSEEEEEE-TTSSEEEEEETTTTEEEEEEEE
T ss_pred EEEecCCCEEEEEeccCCEEEEEEEecCCCceEEEEEEeC-CCCCccEEEEeCCCCEEEEEecCCCeEEEEEEe
Confidence 9999999 33333 4578999997332122222221111 2335789999999999988875 4566666443
No 239
>KOG2314 consensus Translation initiation factor 3, subunit b (eIF-3b) [Translation, ribosomal structure and biogenesis]
Probab=99.07 E-value=1.1e-08 Score=94.06 Aligned_cols=56 Identities=11% Similarity=0.173 Sum_probs=45.9
Q ss_pred eEEEECCCCCEEEEecc--------------------ceeEEEEcCCCCEEEEEeC----------C-CeEEEEeCCCCc
Q 040274 52 ILWILPSSGRYMAVAGR--------------------RTDLMRVNPFNGVVSLGHS----------G-GTVTMWKPTTSA 100 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~--------------------~v~~l~~sp~~~~l~tg~~----------d-g~v~lwd~~~~~ 100 (359)
.-+.|||-|.||++-.. .|.-+.|||..+||+|-+. + ..++|||+.+|.
T Consensus 214 tyv~wSP~GTYL~t~Hk~GI~lWGG~~f~r~~RF~Hp~Vq~idfSP~EkYLVT~s~~p~~~~~~d~e~~~l~IWDI~tG~ 293 (698)
T KOG2314|consen 214 TYVRWSPKGTYLVTFHKQGIALWGGESFDRIQRFYHPGVQFIDFSPNEKYLVTYSPEPIIVEEDDNEGQQLIIWDIATGL 293 (698)
T ss_pred eeEEecCCceEEEEEeccceeeecCccHHHHHhccCCCceeeecCCccceEEEecCCccccCcccCCCceEEEEEccccc
Confidence 77899999999998654 7999999999999999652 1 479999999997
Q ss_pred ceEEeec
Q 040274 101 LLIKMLY 107 (359)
Q Consensus 101 ~~~~~~~ 107 (359)
....|..
T Consensus 294 lkrsF~~ 300 (698)
T KOG2314|consen 294 LKRSFPV 300 (698)
T ss_pred hhcceec
Confidence 6655543
No 240
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=99.06 E-value=1.2e-08 Score=96.63 Aligned_cols=140 Identities=19% Similarity=0.174 Sum_probs=95.5
Q ss_pred ceeEEEEcCCCCEEEEEeCC---CeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEE-ecCCC--eEEEEEcCCCe
Q 040274 69 RTDLMRVNPFNGVVSLGHSG---GTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMAT-TGKEC--KIKIWDLRKYE 142 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~d---g~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s-~~~d~--~i~vwd~~~~~ 142 (359)
.+.+.+|+|+|+.|+.++.+ ..|++||+.++... .+..+.+.+.+++|+|||+.|+. .+.++ .|++||+.++.
T Consensus 191 ~~~~p~~Spdg~~la~~~~~~~~~~i~v~d~~~g~~~-~~~~~~~~~~~~~~spDg~~l~~~~~~~~~~~i~~~d~~~~~ 269 (417)
T TIGR02800 191 PILSPAWSPDGQKLAYVSFESGKPEIYVQDLATGQRE-KVASFPGMNGAPAFSPDGSKLAVSLSKDGNPDIYVMDLDGKQ 269 (417)
T ss_pred ceecccCCCCCCEEEEEEcCCCCcEEEEEECCCCCEE-EeecCCCCccceEECCCCCEEEEEECCCCCccEEEEECCCCC
Confidence 57888999999999887654 47999999987543 33345666778999999987764 44444 59999998765
Q ss_pred eeEee--cCCceeEEEcCCC--cEEEEc-CC--cEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 143 VLQTL--TGHAKTLDFSQKG--LLAVGT-GS--FAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 143 ~~~~~--~~~v~~~~~s~~g--l~~~~~-d~--~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
..... .+......|+|+| ++.++. ++ .|+++|+... . ...+..+ +..+..+.|+|+|++|+.++.++
T Consensus 270 ~~~l~~~~~~~~~~~~s~dg~~l~~~s~~~g~~~iy~~d~~~~-~-~~~l~~~----~~~~~~~~~spdg~~i~~~~~~~ 343 (417)
T TIGR02800 270 LTRLTNGPGIDTEPSWSPDGKSIAFTSDRGGSPQIYMMDADGG-E-VRRLTFR----GGYNASPSWSPDGDLIAFVHREG 343 (417)
T ss_pred EEECCCCCCCCCCEEECCCCCEEEEEECCCCCceEEEEECCCC-C-EEEeecC----CCCccCeEECCCCCEEEEEEccC
Confidence 43222 2334678999999 444443 23 5777775433 2 2222222 12467889999999998887764
No 241
>KOG1064 consensus RAVE (regulator of V-ATPase assembly) complex subunit RAV1/DMX protein, WD repeat superfamily [General function prediction only]
Probab=99.04 E-value=1.8e-09 Score=110.71 Aligned_cols=165 Identities=15% Similarity=0.188 Sum_probs=131.4
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee-cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML-YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~-~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~ 147 (359)
.|.+|.-||...+.+||+.||+|++|....++.+..+. +....|+.+.|+.+|+.+..+..||.+.+|.+. .++....
T Consensus 2210 ~v~r~~sHp~~~~Yltgs~dgsv~~~~w~~~~~v~~~rt~g~s~vtr~~f~~qGnk~~i~d~dg~l~l~q~~-pk~~~s~ 2288 (2439)
T KOG1064|consen 2210 NVRRMTSHPSDPYYLTGSQDGSVRMFEWGHGQQVVCFRTAGNSRVTRSRFNHQGNKFGIVDGDGDLSLWQAS-PKPYTSW 2288 (2439)
T ss_pred ceeeecCCCCCceEEecCCCceEEEEeccCCCeEEEeeccCcchhhhhhhcccCCceeeeccCCceeecccC-Ccceecc
Confidence 78888889999999999999999999999998888876 334889999999999999999999999999987 4444444
Q ss_pred cC---CceeEEEcCCCcEEEE---cCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE--
Q 040274 148 TG---HAKTLDFSQKGLLAVG---TGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI-- 219 (359)
Q Consensus 148 ~~---~v~~~~~s~~gl~~~~---~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i-- 219 (359)
.. ..+++.|-..++++.+ .++.+.+||..-.+.....-..| ...++++++.|....|++|+.+|.+.+
T Consensus 2289 qchnk~~~Df~Fi~s~~~tag~s~d~~n~~lwDtl~~~~~s~v~~~H----~~gaT~l~~~P~~qllisggr~G~v~l~D 2364 (2439)
T KOG1064|consen 2289 QCHNKALSDFRFIGSLLATAGRSSDNRNVCLWDTLLPPMNSLVHTCH----DGGATVLAYAPKHQLLISGGRKGEVCLFD 2364 (2439)
T ss_pred ccCCccccceeeeehhhhccccCCCCCcccchhcccCcccceeeeec----CCCceEEEEcCcceEEEecCCcCcEEEee
Confidence 32 3567777666655554 35799999965443222222344 347999999999999999999999988
Q ss_pred ------------------EEcCCCCCceeeeccCCCC
Q 040274 220 ------------------LVPRSSEPNFDSWVANPFE 238 (359)
Q Consensus 220 ------------------~~~gs~~~~~~~~~~~~~~ 238 (359)
++.|+.++++++|.++.+.
T Consensus 2365 ~rqrql~h~~~~~~~~~~f~~~ss~g~ikIw~~s~~~ 2401 (2439)
T KOG1064|consen 2365 IRQRQLRHTFQALDTREYFVTGSSEGNIKIWRLSEFG 2401 (2439)
T ss_pred hHHHHHHHHhhhhhhhheeeccCcccceEEEEccccc
Confidence 5789999999999987664
No 242
>PRK00178 tolB translocation protein TolB; Provisional
Probab=99.03 E-value=4.1e-08 Score=93.41 Aligned_cols=139 Identities=15% Similarity=0.089 Sum_probs=91.7
Q ss_pred ceeEEEEcCCCCEEEEEeCC---CeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEE-ecCCC--eEEEEEcCCCe
Q 040274 69 RTDLMRVNPFNGVVSLGHSG---GTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMAT-TGKEC--KIKIWDLRKYE 142 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~d---g~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s-~~~d~--~i~vwd~~~~~ 142 (359)
.+....|+|+|+.|+..+.+ ..|.+||+.++.... +....+.+.++.|+|||+.|+. .+.++ .|++||+.++.
T Consensus 200 ~~~~p~wSpDG~~la~~s~~~~~~~l~~~~l~~g~~~~-l~~~~g~~~~~~~SpDG~~la~~~~~~g~~~Iy~~d~~~~~ 278 (430)
T PRK00178 200 PILSPRWSPDGKRIAYVSFEQKRPRIFVQNLDTGRREQ-ITNFEGLNGAPAWSPDGSKLAFVLSKDGNPEIYVMDLASRQ 278 (430)
T ss_pred ceeeeeECCCCCEEEEEEcCCCCCEEEEEECCCCCEEE-ccCCCCCcCCeEECCCCCEEEEEEccCCCceEEEEECCCCC
Confidence 67889999999998876643 369999998876433 3333455667899999998764 44444 68899998876
Q ss_pred eeEee--cCCceeEEEcCCC--cEEEEc-CC--cEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 143 VLQTL--TGHAKTLDFSQKG--LLAVGT-GS--FAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 143 ~~~~~--~~~v~~~~~s~~g--l~~~~~-d~--~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
..... ........|+|+| ++..+. ++ .|+++|+..+ .. ..+... +.......|+|+|++|+..+.+
T Consensus 279 ~~~lt~~~~~~~~~~~spDg~~i~f~s~~~g~~~iy~~d~~~g-~~-~~lt~~----~~~~~~~~~Spdg~~i~~~~~~ 351 (430)
T PRK00178 279 LSRVTNHPAIDTEPFWGKDGRTLYFTSDRGGKPQIYKVNVNGG-RA-ERVTFV----GNYNARPRLSADGKTLVMVHRQ 351 (430)
T ss_pred eEEcccCCCCcCCeEECCCCCEEEEEECCCCCceEEEEECCCC-CE-EEeecC----CCCccceEECCCCCEEEEEEcc
Confidence 43322 3345678999999 444443 33 5777775443 22 111111 1124467899999999877653
No 243
>KOG1275 consensus PAB-dependent poly(A) ribonuclease, subunit PAN2 [Replication, recombination and repair]
Probab=99.03 E-value=4e-09 Score=102.03 Aligned_cols=150 Identities=22% Similarity=0.314 Sum_probs=116.1
Q ss_pred CCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecC---------CCeEEEEEcCCCeeeEeec
Q 040274 78 FNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGK---------ECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 78 ~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~---------d~~i~vwd~~~~~~~~~~~ 148 (359)
++.++.+|+..|+|.+-|+++.+.+.++.+|++.|..+.. .|++|++||. |..|+|||+|+.+.+.-+.
T Consensus 186 Nnr~lf~G~t~G~V~LrD~~s~~~iht~~aHs~siSDfDv--~GNlLitCG~S~R~~~l~~D~FvkVYDLRmmral~PI~ 263 (1118)
T KOG1275|consen 186 NNRNLFCGDTRGTVFLRDPNSFETIHTFDAHSGSISDFDV--QGNLLITCGYSMRRYNLAMDPFVKVYDLRMMRALSPIQ 263 (1118)
T ss_pred cCcEEEeecccceEEeecCCcCceeeeeeccccceeeeec--cCCeEEEeecccccccccccchhhhhhhhhhhccCCcc
Confidence 5789999999999999999999999999999999987655 6889999875 5668999999887766553
Q ss_pred C--CceeEEEcCCC---cEEEEcCCcEEEEcCCCCCcc-ccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEc
Q 040274 149 G--HAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHN-YSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVP 222 (359)
Q Consensus 149 ~--~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~-~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~ 222 (359)
- ...-+.|.|.- ++.++..|.+.+-|......+ ...++.+. .++.+..++++++++.|+.|..+|.+.+|.
T Consensus 264 ~~~~P~flrf~Psl~t~~~V~S~sGq~q~vd~~~lsNP~~~~~~v~p--~~s~i~~fDiSsn~~alafgd~~g~v~~wa- 340 (1118)
T KOG1275|consen 264 FPYGPQFLRFHPSLTTRLAVTSQSGQFQFVDTATLSNPPAGVKMVNP--NGSGISAFDISSNGDALAFGDHEGHVNLWA- 340 (1118)
T ss_pred cccCchhhhhcccccceEEEEecccceeeccccccCCCccceeEEcc--CCCcceeEEecCCCceEEEecccCcEeeec-
Confidence 2 23567788875 777888899999985443333 33444442 344599999999999999999999999998
Q ss_pred CCCCCceeee
Q 040274 223 RSSEPNFDSW 232 (359)
Q Consensus 223 gs~~~~~~~~ 232 (359)
....+.+..+
T Consensus 341 ~~~~P~Fn~~ 350 (1118)
T KOG1275|consen 341 DRPQPQFNEY 350 (1118)
T ss_pred CCCCCccCCC
Confidence 3344444433
No 244
>PRK04792 tolB translocation protein TolB; Provisional
Probab=99.00 E-value=2e-08 Score=95.62 Aligned_cols=145 Identities=17% Similarity=0.068 Sum_probs=91.9
Q ss_pred ceeEEEEcCCCCEEEEEeCC-C--eEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEE-ecCCCe--EEEEEcCCCe
Q 040274 69 RTDLMRVNPFNGVVSLGHSG-G--TVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMAT-TGKECK--IKIWDLRKYE 142 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~d-g--~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s-~~~d~~--i~vwd~~~~~ 142 (359)
.+.+..|+|||+.|+..+.+ + .|++||+.+++... +....+...+..|+|||+.|+. .+.++. |++||+.+++
T Consensus 219 ~~~~p~wSPDG~~La~~s~~~g~~~L~~~dl~tg~~~~-lt~~~g~~~~~~wSPDG~~La~~~~~~g~~~Iy~~dl~tg~ 297 (448)
T PRK04792 219 PLMSPAWSPDGRKLAYVSFENRKAEIFVQDIYTQVREK-VTSFPGINGAPRFSPDGKKLALVLSKDGQPEIYVVDIATKA 297 (448)
T ss_pred cccCceECCCCCEEEEEEecCCCcEEEEEECCCCCeEE-ecCCCCCcCCeeECCCCCEEEEEEeCCCCeEEEEEECCCCC
Confidence 67789999999988876543 3 58899998876432 2222334557899999998765 455564 8888988776
Q ss_pred eeEee--cCCceeEEEcCCC--cEEEEc-CC--cEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeC-C
Q 040274 143 VLQTL--TGHAKTLDFSQKG--LLAVGT-GS--FAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHS-M 214 (359)
Q Consensus 143 ~~~~~--~~~v~~~~~s~~g--l~~~~~-d~--~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~-d 214 (359)
..... ......++|+||| ++..+. ++ .|+++|+..+ .. ..+... +......+|+|||++|+..+. +
T Consensus 298 ~~~lt~~~~~~~~p~wSpDG~~I~f~s~~~g~~~Iy~~dl~~g-~~-~~Lt~~----g~~~~~~~~SpDG~~l~~~~~~~ 371 (448)
T PRK04792 298 LTRITRHRAIDTEPSWHPDGKSLIFTSERGGKPQIYRVNLASG-KV-SRLTFE----GEQNLGGSITPDGRSMIMVNRTN 371 (448)
T ss_pred eEECccCCCCccceEECCCCCEEEEEECCCCCceEEEEECCCC-CE-EEEecC----CCCCcCeeECCCCCEEEEEEecC
Confidence 53322 2345788999999 433332 33 4666675433 22 222111 112445789999999887665 3
Q ss_pred CeEEEE
Q 040274 215 GWSGIL 220 (359)
Q Consensus 215 g~~~i~ 220 (359)
+...|+
T Consensus 372 g~~~I~ 377 (448)
T PRK04792 372 GKFNIA 377 (448)
T ss_pred CceEEE
Confidence 434444
No 245
>PRK04043 tolB translocation protein TolB; Provisional
Probab=98.99 E-value=6.7e-08 Score=90.98 Aligned_cols=155 Identities=12% Similarity=0.016 Sum_probs=98.6
Q ss_pred eEEEECCCCCE-EEEecc-------------------------ceeEEEEcCCCCEEEEEe-CC--CeEEEEeCCCCcce
Q 040274 52 ILWILPSSGRY-MAVAGR-------------------------RTDLMRVNPFNGVVSLGH-SG--GTVTMWKPTTSALL 102 (359)
Q Consensus 52 ~~l~~spdg~~-l~~~~~-------------------------~v~~l~~sp~~~~l~tg~-~d--g~v~lwd~~~~~~~ 102 (359)
....|||||+. ++..+. .+.+..|+|||..|+... .+ ..|.++|+.++..
T Consensus 191 ~~p~wSpDG~~~i~y~s~~~~~~~Iyv~dl~tg~~~~lt~~~g~~~~~~~SPDG~~la~~~~~~g~~~Iy~~dl~~g~~- 269 (419)
T PRK04043 191 IFPKWANKEQTAFYYTSYGERKPTLYKYNLYTGKKEKIASSQGMLVVSDVSKDGSKLLLTMAPKGQPDIYLYDTNTKTL- 269 (419)
T ss_pred EeEEECCCCCcEEEEEEccCCCCEEEEEECCCCcEEEEecCCCcEEeeEECCCCCEEEEEEccCCCcEEEEEECCCCcE-
Confidence 67899999985 554322 355788999998765543 33 4688889887753
Q ss_pred EEeecCCCCeEEEEEecCCCEEEEecC-CC--eEEEEEcCCCeeeEee-cCCceeEEEcCCC--cEEEEcC---------
Q 040274 103 IKMLYHQGPVSALAFHPNGHLMATTGK-EC--KIKIWDLRKYEVLQTL-TGHAKTLDFSQKG--LLAVGTG--------- 167 (359)
Q Consensus 103 ~~~~~h~~~v~~l~~~p~g~~l~s~~~-d~--~i~vwd~~~~~~~~~~-~~~v~~~~~s~~g--l~~~~~d--------- 167 (359)
..+..+.+......|+|||+.|+..+. .+ .|+++|+.+++..... .+. ....|||+| ++..+..
T Consensus 270 ~~LT~~~~~d~~p~~SPDG~~I~F~Sdr~g~~~Iy~~dl~~g~~~rlt~~g~-~~~~~SPDG~~Ia~~~~~~~~~~~~~~ 348 (419)
T PRK04043 270 TQITNYPGIDVNGNFVEDDKRIVFVSDRLGYPNIFMKKLNSGSVEQVVFHGK-NNSSVSTYKNYIVYSSRETNNEFGKNT 348 (419)
T ss_pred EEcccCCCccCccEECCCCCEEEEEECCCCCceEEEEECCCCCeEeCccCCC-cCceECCCCCEEEEEEcCCCcccCCCC
Confidence 344444444456789999987766553 23 6888899887763333 232 345899999 4444332
Q ss_pred CcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 168 SFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 168 ~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
..|.++|+..+ . ...+... . ......|+|||+.|+..+..+
T Consensus 349 ~~I~v~d~~~g-~-~~~LT~~-~----~~~~p~~SPDG~~I~f~~~~~ 389 (419)
T PRK04043 349 FNLYLISTNSD-Y-IRRLTAN-G----VNQFPRFSSDGGSIMFIKYLG 389 (419)
T ss_pred cEEEEEECCCC-C-eEECCCC-C----CcCCeEECCCCCEEEEEEccC
Confidence 36778885444 2 2222222 1 234689999999887766544
No 246
>KOG2695 consensus WD40 repeat protein [General function prediction only]
Probab=98.97 E-value=1e-09 Score=95.30 Aligned_cols=133 Identities=19% Similarity=0.270 Sum_probs=102.2
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCC-----cceEEeecCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCCCe
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTS-----ALLIKMLYHQGPVSALAFHP-NGHLMATTGKECKIKIWDLRKYE 142 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~-----~~~~~~~~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~~~ 142 (359)
.|.++.|...+++++.|+.+|.|..+|++.+ .+...+ -|.+.|+++..-. ++.+|++++.+|.|++||.|.-+
T Consensus 254 DVfAlQf~~s~nLv~~GcRngeI~~iDLR~rnqG~~~~a~rl-yh~Ssvtslq~Lq~s~q~LmaS~M~gkikLyD~R~~K 332 (425)
T KOG2695|consen 254 DVFALQFAGSDNLVFNGCRNGEIFVIDLRCRNQGNGWCAQRL-YHDSSVTSLQILQFSQQKLMASDMTGKIKLYDLRATK 332 (425)
T ss_pred hHHHHHhcccCCeeEecccCCcEEEEEeeecccCCCcceEEE-EcCcchhhhhhhccccceEeeccCcCceeEeeehhhh
Confidence 7899999998899999999999999999865 233333 6889999988765 78899999999999999999877
Q ss_pred e---eEeecCCceeEEEcCC------C-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEcc
Q 040274 143 V---LQTLTGHAKTLDFSQK------G-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRP 203 (359)
Q Consensus 143 ~---~~~~~~~v~~~~~s~~------g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp 203 (359)
+ +.++.|||+..++.|- | ++++|.|...+||.+..+ .....++.........+.+++|..
T Consensus 333 ~~~~V~qYeGHvN~~a~l~~~v~~eeg~I~s~GdDcytRiWsl~~g-hLl~tipf~~s~~e~d~~sv~~~s 402 (425)
T KOG2695|consen 333 CKKSVMQYEGHVNLSAYLPAHVKEEEGSIFSVGDDCYTRIWSLDSG-HLLCTIPFPYSASEVDIPSVAFDS 402 (425)
T ss_pred cccceeeeecccccccccccccccccceEEEccCeeEEEEEecccC-ceeeccCCCCccccccccceehhc
Confidence 6 8899999987777652 3 888999999999996544 444444433222233466666643
No 247
>KOG0280 consensus Uncharacterized conserved protein [Amino acid transport and metabolism]
Probab=98.95 E-value=1.4e-08 Score=86.67 Aligned_cols=142 Identities=13% Similarity=0.109 Sum_probs=106.0
Q ss_pred eeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcc--eEEeecCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCC-CeeeE
Q 040274 70 TDLMRVNPFNGVVSLGHSGGTVTMWKPTTSAL--LIKMLYHQGPVSALAFHP-NGHLMATTGKECKIKIWDLRK-YEVLQ 145 (359)
Q Consensus 70 v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~--~~~~~~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~-~~~~~ 145 (359)
..++.|++.+..++++..+|.+.+-+...... ++.++.|.-+++-+.|+. +.+++++||.|+.+..||+|. ++.+.
T Consensus 124 ~lslD~~~~~~~i~vs~s~G~~~~v~~t~~~le~vq~wk~He~E~Wta~f~~~~pnlvytGgDD~~l~~~D~R~p~~~i~ 203 (339)
T KOG0280|consen 124 ALSLDISTSGTKIFVSDSRGSISGVYETEMVLEKVQTWKVHEFEAWTAKFSDKEPNLVYTGGDDGSLSCWDIRIPKTFIW 203 (339)
T ss_pred eeEEEeeccCceEEEEcCCCcEEEEecceeeeeecccccccceeeeeeecccCCCceEEecCCCceEEEEEecCCcceee
Confidence 56888999998999999999999666554433 347789999999999976 557899999999999999993 44433
Q ss_pred ee----cCCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCC--CEEEEEeCCCe
Q 040274 146 TL----TGHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYE--DVLGIGHSMGW 216 (359)
Q Consensus 146 ~~----~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~--~~l~~g~~dg~ 216 (359)
.- ...|.+|.-+|.- +++|++|..|++||+++-++++..-.. ++.|+.+.++|.- .+|+++-.+|.
T Consensus 204 ~n~kvH~~GV~SI~ss~~~~~~I~TGsYDe~i~~~DtRnm~kPl~~~~v-----~GGVWRi~~~p~~~~~lL~~CMh~G~ 278 (339)
T KOG0280|consen 204 HNSKVHTSGVVSIYSSPPKPTYIATGSYDECIRVLDTRNMGKPLFKAKV-----GGGVWRIKHHPEIFHRLLAACMHNGA 278 (339)
T ss_pred ecceeeecceEEEecCCCCCceEEEeccccceeeeehhcccCccccCcc-----ccceEEEEecchhhhHHHHHHHhcCc
Confidence 32 3457788777764 888999999999998766555443322 2369999999953 44555555654
No 248
>PRK01029 tolB translocation protein TolB; Provisional
Probab=98.95 E-value=2.6e-08 Score=94.23 Aligned_cols=148 Identities=11% Similarity=0.084 Sum_probs=95.9
Q ss_pred eEEEECCCCCEEEEecc-------------------------------ceeEEEEcCCCCEEEEEe-CCCeEEEE--eCC
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------------RTDLMRVNPFNGVVSLGH-SGGTVTMW--KPT 97 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------------~v~~l~~sp~~~~l~tg~-~dg~v~lw--d~~ 97 (359)
+...|||||+.|+..+. .....+|+|||..|+..+ .+|...+| ++.
T Consensus 234 ~~p~wSPDG~~Laf~s~~~g~~di~~~~~~~~~g~~g~~~~lt~~~~~~~~~p~wSPDG~~Laf~s~~~g~~~ly~~~~~ 313 (428)
T PRK01029 234 LMPTFSPRKKLLAFISDRYGNPDLFIQSFSLETGAIGKPRRLLNEAFGTQGNPSFSPDGTRLVFVSNKDGRPRIYIMQID 313 (428)
T ss_pred cceEECCCCCEEEEEECCCCCcceeEEEeecccCCCCcceEeecCCCCCcCCeEECCCCCEEEEEECCCCCceEEEEECc
Confidence 67889999998875431 224678999999877765 46655555 443
Q ss_pred C-CcceEEeecCCCCeEEEEEecCCCEEEEecCC---CeEEEEEcCCCeeeEee--cCCceeEEEcCCC--cEEEEc---
Q 040274 98 T-SALLIKMLYHQGPVSALAFHPNGHLMATTGKE---CKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG--LLAVGT--- 166 (359)
Q Consensus 98 ~-~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d---~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g--l~~~~~--- 166 (359)
. +.....+..+...+....|+|||+.|+.++.+ ..|.+||+.+++..... ...+.++.|+||| ++..+.
T Consensus 314 ~~g~~~~~lt~~~~~~~~p~wSPDG~~Laf~~~~~g~~~I~v~dl~~g~~~~Lt~~~~~~~~p~wSpDG~~L~f~~~~~g 393 (428)
T PRK01029 314 PEGQSPRLLTKKYRNSSCPAWSPDGKKIAFCSVIKGVRQICVYDLATGRDYQLTTSPENKESPSWAIDSLHLVYSAGNSN 393 (428)
T ss_pred ccccceEEeccCCCCccceeECCCCCEEEEEEcCCCCcEEEEEECCCCCeEEccCCCCCccceEECCCCCEEEEEECCCC
Confidence 2 23344454555677889999999988876543 46999999888654333 2356789999999 433332
Q ss_pred CCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCC
Q 040274 167 GSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYE 205 (359)
Q Consensus 167 d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~ 205 (359)
...|.++|+..+ .. ..+....+ .+...+|+|..
T Consensus 394 ~~~L~~vdl~~g-~~-~~Lt~~~g----~~~~p~Ws~~~ 426 (428)
T PRK01029 394 ESELYLISLITK-KT-RKIVIGSG----EKRFPSWGAFP 426 (428)
T ss_pred CceEEEEECCCC-CE-EEeecCCC----cccCceecCCC
Confidence 246788885443 22 22222211 46678888864
No 249
>KOG0322 consensus G-protein beta subunit-like protein GNB1L, contains WD repeats [General function prediction only]
Probab=98.93 E-value=1.4e-09 Score=91.18 Aligned_cols=70 Identities=26% Similarity=0.456 Sum_probs=68.1
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEc
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDL 138 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~ 138 (359)
.|..+.+-||+++++|++.|+.|+||+.++..++..+.-|.+.|++++|+|+..++|.++.|+.|.+|++
T Consensus 253 Gv~gvrIRpD~KIlATAGWD~RiRVyswrtl~pLAVLkyHsagvn~vAfspd~~lmAaaskD~rISLWkL 322 (323)
T KOG0322|consen 253 GVSGVRIRPDGKILATAGWDHRIRVYSWRTLNPLAVLKYHSAGVNAVAFSPDCELMAAASKDARISLWKL 322 (323)
T ss_pred CccceEEccCCcEEeecccCCcEEEEEeccCCchhhhhhhhcceeEEEeCCCCchhhhccCCceEEeeec
Confidence 7899999999999999999999999999999999999999999999999999999999999999999986
No 250
>PF02239 Cytochrom_D1: Cytochrome D1 heme domain; PDB: 1NNO_B 1HZU_A 1N15_B 1N50_A 1GJQ_A 1BL9_B 1NIR_B 1N90_B 1HZV_A 1AOQ_A ....
Probab=98.93 E-value=1.8e-07 Score=86.50 Aligned_cols=145 Identities=10% Similarity=0.104 Sum_probs=96.7
Q ss_pred eEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEec-CCCeEEEEEcCCCeeeEeecC
Q 040274 71 DLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTG-KECKIKIWDLRKYEVLQTLTG 149 (359)
Q Consensus 71 ~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~-~d~~i~vwd~~~~~~~~~~~~ 149 (359)
..+.|+||++++++++.||.|.++|+.+.+.+..+.... ...++++++||+++++++ .++.+.++|..+.+++..++.
T Consensus 40 ~~~~~s~Dgr~~yv~~rdg~vsviD~~~~~~v~~i~~G~-~~~~i~~s~DG~~~~v~n~~~~~v~v~D~~tle~v~~I~~ 118 (369)
T PF02239_consen 40 AGLKFSPDGRYLYVANRDGTVSVIDLATGKVVATIKVGG-NPRGIAVSPDGKYVYVANYEPGTVSVIDAETLEPVKTIPT 118 (369)
T ss_dssp EEEE-TT-SSEEEEEETTSEEEEEETTSSSEEEEEE-SS-EEEEEEE--TTTEEEEEEEETTEEEEEETTT--EEEEEE-
T ss_pred eEEEecCCCCEEEEEcCCCeEEEEECCcccEEEEEecCC-CcceEEEcCCCCEEEEEecCCCceeEeccccccceeeccc
Confidence 346789999999999999999999999999888887644 458899999999988776 689999999999999888731
Q ss_pred ----------CceeEEEcCCC--cEEEEcC-CcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEe-CCC
Q 040274 150 ----------HAKTLDFSQKG--LLAVGTG-SFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGH-SMG 215 (359)
Q Consensus 150 ----------~v~~~~~s~~g--l~~~~~d-~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~-~dg 215 (359)
.+..+..+|.. ++..-.+ +.|.+.|............. .+.......|+|++++++++. .+.
T Consensus 119 ~~~~~~~~~~Rv~aIv~s~~~~~fVv~lkd~~~I~vVdy~d~~~~~~~~i~----~g~~~~D~~~dpdgry~~va~~~sn 194 (369)
T PF02239_consen 119 GGMPVDGPESRVAAIVASPGRPEFVVNLKDTGEIWVVDYSDPKNLKVTTIK----VGRFPHDGGFDPDGRYFLVAANGSN 194 (369)
T ss_dssp -EE-TTTS---EEEEEE-SSSSEEEEEETTTTEEEEEETTTSSCEEEEEEE------TTEEEEEE-TTSSEEEEEEGGGT
T ss_pred ccccccccCCCceeEEecCCCCEEEEEEccCCeEEEEEeccccccceeeec----ccccccccccCcccceeeecccccc
Confidence 34567777777 4444444 78888785443222212211 122577899999999887753 344
Q ss_pred eEEEE
Q 040274 216 WSGIL 220 (359)
Q Consensus 216 ~~~i~ 220 (359)
.+.++
T Consensus 195 ~i~vi 199 (369)
T PF02239_consen 195 KIAVI 199 (369)
T ss_dssp EEEEE
T ss_pred eeEEE
Confidence 44443
No 251
>COG2706 3-carboxymuconate cyclase [Carbohydrate transport and metabolism]
Probab=98.91 E-value=7.5e-07 Score=78.47 Aligned_cols=164 Identities=14% Similarity=0.202 Sum_probs=112.0
Q ss_pred eEEEECCCCCEEEEecc------------------------------ceeEEEEcCCCCEEEEEeC-CCeEEEEeCCC-C
Q 040274 52 ILWILPSSGRYMAVAGR------------------------------RTDLMRVNPFNGVVSLGHS-GGTVTMWKPTT-S 99 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------------~v~~l~~sp~~~~l~tg~~-dg~v~lwd~~~-~ 99 (359)
.-|+|+|++++|.++.. +...+++++++.+++++.. .|.|.++-++. |
T Consensus 43 tyl~~~~~~~~LY~v~~~~~~ggvaay~iD~~~G~Lt~ln~~~~~g~~p~yvsvd~~g~~vf~AnY~~g~v~v~p~~~dG 122 (346)
T COG2706 43 TYLAVNPDQRHLYVVNEPGEEGGVAAYRIDPDDGRLTFLNRQTLPGSPPCYVSVDEDGRFVFVANYHSGSVSVYPLQADG 122 (346)
T ss_pred ceEEECCCCCEEEEEEecCCcCcEEEEEEcCCCCeEEEeeccccCCCCCeEEEECCCCCEEEEEEccCceEEEEEcccCC
Confidence 66778888877776554 4478889999999888874 57899998865 3
Q ss_pred cc--eEEeecCCCC----------eEEEEEecCCCEEEEecC-CCeEEEEEcCCCeeeEee------cCCceeEEEcCCC
Q 040274 100 AL--LIKMLYHQGP----------VSALAFHPNGHLMATTGK-ECKIKIWDLRKYEVLQTL------TGHAKTLDFSQKG 160 (359)
Q Consensus 100 ~~--~~~~~~h~~~----------v~~l~~~p~g~~l~s~~~-d~~i~vwd~~~~~~~~~~------~~~v~~~~~s~~g 160 (359)
.. ...+..|.+. +.+..+.|++++|++++. --.|.+|++..|.....- ......|.|+|+|
T Consensus 123 ~l~~~v~~~~h~g~~p~~rQ~~~h~H~a~~tP~~~~l~v~DLG~Dri~~y~~~dg~L~~~~~~~v~~G~GPRHi~FHpn~ 202 (346)
T COG2706 123 SLQPVVQVVKHTGSGPHERQESPHVHSANFTPDGRYLVVPDLGTDRIFLYDLDDGKLTPADPAEVKPGAGPRHIVFHPNG 202 (346)
T ss_pred ccccceeeeecCCCCCCccccCCccceeeeCCCCCEEEEeecCCceEEEEEcccCccccccccccCCCCCcceEEEcCCC
Confidence 22 2223356666 899999999999988764 245999999876543222 2336889999999
Q ss_pred ---cEEEEcCCcEEEEcCCCCCccccccccccC-----CCCcceeEEEEccCCCEEEEEeCCC
Q 040274 161 ---LLAVGTGSFAQILGDFSGSHNYSRYMGNSM-----VKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 161 ---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~-----~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
++.+-.+++|.+|...........+..+.. ........+..+|||++|.++....
T Consensus 203 k~aY~v~EL~stV~v~~y~~~~g~~~~lQ~i~tlP~dF~g~~~~aaIhis~dGrFLYasNRg~ 265 (346)
T COG2706 203 KYAYLVNELNSTVDVLEYNPAVGKFEELQTIDTLPEDFTGTNWAAAIHISPDGRFLYASNRGH 265 (346)
T ss_pred cEEEEEeccCCEEEEEEEcCCCceEEEeeeeccCccccCCCCceeEEEECCCCCEEEEecCCC
Confidence 455556899999985443222222111100 0223577899999999998776543
No 252
>COG2706 3-carboxymuconate cyclase [Carbohydrate transport and metabolism]
Probab=98.90 E-value=5.4e-07 Score=79.36 Aligned_cols=162 Identities=14% Similarity=0.162 Sum_probs=115.7
Q ss_pred eEEEECCCCCEEEEecc-------------------------------------ceeEEEEcCCCCEEEEEeC-CCeEEE
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------------------RTDLMRVNPFNGVVSLGHS-GGTVTM 93 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------------------~v~~l~~sp~~~~l~tg~~-dg~v~l 93 (359)
..++++++|++|+++.. .+++..+.|++++|++.+- --.|.+
T Consensus 92 ~yvsvd~~g~~vf~AnY~~g~v~v~p~~~dG~l~~~v~~~~h~g~~p~~rQ~~~h~H~a~~tP~~~~l~v~DLG~Dri~~ 171 (346)
T COG2706 92 CYVSVDEDGRFVFVANYHSGSVSVYPLQADGSLQPVVQVVKHTGSGPHERQESPHVHSANFTPDGRYLVVPDLGTDRIFL 171 (346)
T ss_pred eEEEECCCCCEEEEEEccCceEEEEEcccCCccccceeeeecCCCCCCccccCCccceeeeCCCCCEEEEeecCCceEEE
Confidence 67899999999998776 3899999999999888763 236899
Q ss_pred EeCCCCcce----EEeecCCCCeEEEEEecCCCEEEEec-CCCeEEEEEcCCC----eeeEee---c------CCceeEE
Q 040274 94 WKPTTSALL----IKMLYHQGPVSALAFHPNGHLMATTG-KECKIKIWDLRKY----EVLQTL---T------GHAKTLD 155 (359)
Q Consensus 94 wd~~~~~~~----~~~~~h~~~v~~l~~~p~g~~l~s~~-~d~~i~vwd~~~~----~~~~~~---~------~~v~~~~ 155 (359)
|++..+... ..+. ....-..|.|+|++++..+.+ .+++|-+|..... +.++++ + .....|.
T Consensus 172 y~~~dg~L~~~~~~~v~-~G~GPRHi~FHpn~k~aY~v~EL~stV~v~~y~~~~g~~~~lQ~i~tlP~dF~g~~~~aaIh 250 (346)
T COG2706 172 YDLDDGKLTPADPAEVK-PGAGPRHIVFHPNGKYAYLVNELNSTVDVLEYNPAVGKFEELQTIDTLPEDFTGTNWAAAIH 250 (346)
T ss_pred EEcccCccccccccccC-CCCCcceEEEcCCCcEEEEEeccCCEEEEEEEcCCCceEEEeeeeccCccccCCCCceeEEE
Confidence 999866432 1222 233458899999999977766 5999999998763 234433 1 2357889
Q ss_pred EcCCC-cEEEEcC--CcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 156 FSQKG-LLAVGTG--SFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 156 ~s~~g-l~~~~~d--~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
+++|| ++.++.. ..|.+|.+...+..+........ .+.....+.|+|+|++|++++.++
T Consensus 251 is~dGrFLYasNRg~dsI~~f~V~~~~g~L~~~~~~~t-eg~~PR~F~i~~~g~~Liaa~q~s 312 (346)
T COG2706 251 ISPDGRFLYASNRGHDSIAVFSVDPDGGKLELVGITPT-EGQFPRDFNINPSGRFLIAANQKS 312 (346)
T ss_pred ECCCCCEEEEecCCCCeEEEEEEcCCCCEEEEEEEecc-CCcCCccceeCCCCCEEEEEccCC
Confidence 99999 6666654 47888876554343433333222 444578899999999999988765
No 253
>KOG1354 consensus Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=98.88 E-value=1.9e-08 Score=87.48 Aligned_cols=152 Identities=10% Similarity=0.155 Sum_probs=99.6
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCC---cceEEeecCC-----CCeEEEEEecC-CCEEEEecCCCeEEEEEcC
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTS---ALLIKMLYHQ-----GPVSALAFHPN-GHLMATTGKECKIKIWDLR 139 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~---~~~~~~~~h~-----~~v~~l~~~p~-g~~l~s~~~d~~i~vwd~~ 139 (359)
.|+++.++.|...++++ .|=.|.+|++.-. -.+..++.+. .-|++..|+|. .+.|+.++..|+|++-|+|
T Consensus 166 hiNSIS~NsD~Et~lSA-DdLRINLWnlei~d~sFnIVDIKP~nmEeLteVITsaEFhp~~cn~f~YSSSKGtIrLcDmR 244 (433)
T KOG1354|consen 166 HINSISVNSDKETFLSA-DDLRINLWNLEIIDQSFNIVDIKPANMEELTEVITSAEFHPHHCNVFVYSSSKGTIRLCDMR 244 (433)
T ss_pred EeeeeeecCccceEeec-cceeeeeccccccCCceeEEEccccCHHHHHHHHhhhccCHhHccEEEEecCCCcEEEeech
Confidence 56677777666666555 3456667765421 1133333332 35788899994 4568888899999999999
Q ss_pred CCeeeE----ee---------------cCCceeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccC--------C
Q 040274 140 KYEVLQ----TL---------------TGHAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSM--------V 191 (359)
Q Consensus 140 ~~~~~~----~~---------------~~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~--------~ 191 (359)
...+.- .+ -..|+++.|+++| ++.+-.--+|.+||+.....++..+..|.. .
T Consensus 245 ~~aLCd~hsKlfEepedp~~rsffseiIsSISDvKFs~sGryilsRDyltvk~wD~nme~~pv~t~~vh~~lr~kLc~lY 324 (433)
T KOG1354|consen 245 QSALCDAHSKLFEEPEDPSSRSFFSEIISSISDVKFSHSGRYILSRDYLTVKLWDLNMEAKPVETYPVHEYLRSKLCSLY 324 (433)
T ss_pred hhhhhcchhhhhccccCCcchhhHHHHhhhhhceEEccCCcEEEEeccceeEEEeccccCCcceEEeehHhHHHHHHHHh
Confidence 533211 11 1247899999999 555544589999998665566655554421 0
Q ss_pred CC---cceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 192 KG---YQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 192 ~~---~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
.. ..-..++|+.++.++++|+.....+++.
T Consensus 325 EnD~IfdKFec~~sg~~~~v~TGsy~n~frvf~ 357 (433)
T KOG1354|consen 325 ENDAIFDKFECSWSGNDSYVMTGSYNNVFRVFN 357 (433)
T ss_pred hccchhheeEEEEcCCcceEecccccceEEEec
Confidence 00 0124578999999999999999888887
No 254
>KOG2111 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=98.88 E-value=2.9e-07 Score=79.55 Aligned_cols=149 Identities=15% Similarity=0.178 Sum_probs=96.6
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCC-CCcceEEeecCC--CCeEEEEEecCCCEEEEec-CCCeEEEEEcCCCee-
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPT-TSALLIKMLYHQ--GPVSALAFHPNGHLMATTG-KECKIKIWDLRKYEV- 143 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~-~~~~~~~~~~h~--~~v~~l~~~p~g~~l~s~~-~d~~i~vwd~~~~~~- 143 (359)
+|.++.+.++. |++. ..+.|.||... ..+.+..+.... ..+.+++-+.+..+||.-| .-|.|.|-|+.....
T Consensus 96 ~I~~V~l~r~r--iVvv-l~~~I~VytF~~n~k~l~~~et~~NPkGlC~~~~~~~k~~LafPg~k~GqvQi~dL~~~~~~ 172 (346)
T KOG2111|consen 96 EIKAVKLRRDR--IVVV-LENKIYVYTFPDNPKLLHVIETRSNPKGLCSLCPTSNKSLLAFPGFKTGQVQIVDLASTKPN 172 (346)
T ss_pred ceeeEEEcCCe--EEEE-ecCeEEEEEcCCChhheeeeecccCCCceEeecCCCCceEEEcCCCccceEEEEEhhhcCcC
Confidence 56666666543 3333 24678888766 334444444222 2233333333444555544 468999999976443
Q ss_pred ----eEeecCCceeEEEcCCC--cEEEEcCCc-EEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCe
Q 040274 144 ----LQTLTGHAKTLDFSQKG--LLAVGTGSF-AQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGW 216 (359)
Q Consensus 144 ----~~~~~~~v~~~~~s~~g--l~~~~~d~~-i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~ 216 (359)
+....+.|.|++.+.+| ++++|..|+ |+|||..++......-.+. ....|+|++|||++.+|+++|+.|+
T Consensus 173 ~p~~I~AH~s~Iacv~Ln~~Gt~vATaStkGTLIRIFdt~~g~~l~E~RRG~---d~A~iy~iaFSp~~s~LavsSdKgT 249 (346)
T KOG2111|consen 173 APSIINAHDSDIACVALNLQGTLVATASTKGTLIRIFDTEDGTLLQELRRGV---DRADIYCIAFSPNSSWLAVSSDKGT 249 (346)
T ss_pred CceEEEcccCceeEEEEcCCccEEEEeccCcEEEEEEEcCCCcEeeeeecCC---chheEEEEEeCCCccEEEEEcCCCe
Confidence 22335679999999999 556666665 6899977764444332222 3457999999999999999999999
Q ss_pred EEEEEcC
Q 040274 217 SGILVPR 223 (359)
Q Consensus 217 ~~i~~~g 223 (359)
+.|+.--
T Consensus 250 lHiF~l~ 256 (346)
T KOG2111|consen 250 LHIFSLR 256 (346)
T ss_pred EEEEEee
Confidence 9987543
No 255
>KOG0974 consensus WD-repeat protein WDR6, WD repeat superfamily [General function prediction only]
Probab=98.87 E-value=1.7e-08 Score=99.08 Aligned_cols=106 Identities=14% Similarity=0.182 Sum_probs=92.0
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceE-EeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLI-KMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~-~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~ 147 (359)
.|.++.|+-+|.++++.|.|.++++|++.+.+... ...+|+..|+.++|+|+ .++|++.|.++++|+.. +..+..+
T Consensus 177 ~iF~i~~s~dg~~i~s~SdDRsiRlW~i~s~~~~~~~~fgHsaRvw~~~~~~n--~i~t~gedctcrvW~~~-~~~l~~y 253 (967)
T KOG0974|consen 177 SIFSIVTSLDGRYIASVSDDRSIRLWPIDSREVLGCTGFGHSARVWACCFLPN--RIITVGEDCTCRVWGVN-GTQLEVY 253 (967)
T ss_pred ceEEEEEccCCcEEEEEecCcceeeeecccccccCcccccccceeEEEEeccc--eeEEeccceEEEEEecc-cceehhh
Confidence 78999999999999999999999999999987665 67799999999999998 99999999999999765 3444455
Q ss_pred ----cCCceeEEEcCCC--cEEEEcCCcEEEEcCCC
Q 040274 148 ----TGHAKTLDFSQKG--LLAVGTGSFAQILGDFS 177 (359)
Q Consensus 148 ----~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~ 177 (359)
..++..++..++. .++++.|+.+.+||...
T Consensus 254 ~~h~g~~iw~~~~~~~~~~~vT~g~Ds~lk~~~l~~ 289 (967)
T KOG0974|consen 254 DEHSGKGIWKIAVPIGVIIKVTGGNDSTLKLWDLNG 289 (967)
T ss_pred hhhhhcceeEEEEcCCceEEEeeccCcchhhhhhhc
Confidence 3468899998887 88899999999999643
No 256
>KOG2315 consensus Predicted translation initiation factor related to eIF-3a [Translation, ribosomal structure and biogenesis]
Probab=98.86 E-value=8.5e-08 Score=88.49 Aligned_cols=128 Identities=18% Similarity=0.406 Sum_probs=95.1
Q ss_pred ceeEEEEcCCCCEEEE--EeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecC---CCeEEEEEcCCCee
Q 040274 69 RTDLMRVNPFNGVVSL--GHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGK---ECKIKIWDLRKYEV 143 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~t--g~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~---d~~i~vwd~~~~~~ 143 (359)
+|+++.|+|++.-|++ |-.--.|.|+|++ +.++..| ..++-+++-|+|.|++++.+|- -|.|-|||+.+.++
T Consensus 272 PVhdv~W~~s~~EF~VvyGfMPAkvtifnlr-~~~v~df--~egpRN~~~fnp~g~ii~lAGFGNL~G~mEvwDv~n~K~ 348 (566)
T KOG2315|consen 272 PVHDVTWSPSGREFAVVYGFMPAKVTIFNLR-GKPVFDF--PEGPRNTAFFNPHGNIILLAGFGNLPGDMEVWDVPNRKL 348 (566)
T ss_pred CceEEEECCCCCEEEEEEecccceEEEEcCC-CCEeEeC--CCCCccceEECCCCCEEEEeecCCCCCceEEEeccchhh
Confidence 8999999999976544 5567789999987 5555555 4778899999999999888775 48899999999888
Q ss_pred eEeec-CCceeEEEcCCC--cEEEEc------CCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCC
Q 040274 144 LQTLT-GHAKTLDFSQKG--LLAVGT------GSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYED 206 (359)
Q Consensus 144 ~~~~~-~~v~~~~~s~~g--l~~~~~------d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~ 206 (359)
+..+. ...+-+.|+||| +++++. |+.+.||+ .++ ..+...+-. +..+.+.|-|...
T Consensus 349 i~~~~a~~tt~~eW~PdGe~flTATTaPRlrvdNg~Kiwh-ytG-~~l~~~~f~-----sEL~qv~W~P~~~ 413 (566)
T KOG2315|consen 349 IAKFKAANTTVFEWSPDGEYFLTATTAPRLRVDNGIKIWH-YTG-SLLHEKMFK-----SELLQVEWRPFND 413 (566)
T ss_pred ccccccCCceEEEEcCCCcEEEEEeccccEEecCCeEEEE-ecC-ceeehhhhh-----HhHhheeeeecCC
Confidence 88884 345778999999 666554 68899998 344 222222111 0367788887543
No 257
>PF00400 WD40: WD domain, G-beta repeat; InterPro: IPR019781 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events.; PDB: 2ZKQ_a 3CFV_B 3CFS_B 1PEV_A 1NR0_A 1VYH_T 3RFH_A 3O2Z_T 3FRX_C 3U5G_g ....
Probab=98.84 E-value=1.2e-08 Score=61.80 Aligned_cols=38 Identities=21% Similarity=0.605 Sum_probs=36.3
Q ss_pred cceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEE
Q 040274 100 ALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWD 137 (359)
Q Consensus 100 ~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd 137 (359)
+++.++.+|.+.|++++|+|++.+|++++.|+.|++||
T Consensus 2 ~~~~~~~~h~~~i~~i~~~~~~~~~~s~~~D~~i~vwd 39 (39)
T PF00400_consen 2 KCVRTFRGHSSSINSIAWSPDGNFLASGSSDGTIRVWD 39 (39)
T ss_dssp EEEEEEESSSSSEEEEEEETTSSEEEEEETTSEEEEEE
T ss_pred eEEEEEcCCCCcEEEEEEecccccceeeCCCCEEEEEC
Confidence 57788999999999999999999999999999999998
No 258
>PF15492 Nbas_N: Neuroblastoma-amplified sequence, N terminal
Probab=98.83 E-value=1.3e-06 Score=74.83 Aligned_cols=170 Identities=15% Similarity=0.121 Sum_probs=110.2
Q ss_pred eEEEECCCCCEEEEecc---------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEE
Q 040274 52 ILWILPSSGRYMAVAGR---------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIK 104 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~---------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~ 104 (359)
|.++.++||+.||.-.+ .-.-++||||+.+||.+...|+|+++|+.. ..+..
T Consensus 1 W~~~~~~~Gk~lAi~qd~~iEiRsa~Ddf~si~~kcqVpkD~~PQWRkl~WSpD~tlLa~a~S~G~i~vfdl~g-~~lf~ 79 (282)
T PF15492_consen 1 WHLALSSDGKLLAILQDQCIEIRSAKDDFSSIIGKCQVPKDPNPQWRKLAWSPDCTLLAYAESTGTIRVFDLMG-SELFV 79 (282)
T ss_pred CceeecCCCcEEEEEeccEEEEEeccCCchheeEEEecCCCCCchheEEEECCCCcEEEEEcCCCeEEEEeccc-ceeEE
Confidence 35778899999988766 447799999999999999999999999874 33333
Q ss_pred eec-------CCCCeEEEEEecC------CCEEEEecCCCeEEEEEcCC-----CeeeEee------cCCceeEEEcCCC
Q 040274 105 MLY-------HQGPVSALAFHPN------GHLMATTGKECKIKIWDLRK-----YEVLQTL------TGHAKTLDFSQKG 160 (359)
Q Consensus 105 ~~~-------h~~~v~~l~~~p~------g~~l~s~~~d~~i~vwd~~~-----~~~~~~~------~~~v~~~~~s~~g 160 (359)
+.. -...|.++.|-+. ...|++.+-+|.++-|-+.. .+..+++ +..|+++.|+|..
T Consensus 80 I~p~~~~~~d~~~Aiagl~Fl~~~~s~~ws~ELlvi~Y~G~L~Sy~vs~gt~q~y~e~hsfsf~~~yp~Gi~~~vy~p~h 159 (282)
T PF15492_consen 80 IPPAMSFPGDLSDAIAGLIFLEYKKSAQWSYELLVINYRGQLRSYLVSVGTNQGYQENHSFSFSSHYPHGINSAVYHPKH 159 (282)
T ss_pred cCcccccCCccccceeeeEeeccccccccceeEEEEeccceeeeEEEEcccCCcceeeEEEEecccCCCceeEEEEcCCC
Confidence 331 1245666666442 11466666777777776532 3344444 3458999999987
Q ss_pred --cEEEEc-C----------CcEEEEcCCCCCcc----------cc---------ccc-----cccCCCCcceeEEEEcc
Q 040274 161 --LLAVGT-G----------SFAQILGDFSGSHN----------YS---------RYM-----GNSMVKGYQIGKVSFRP 203 (359)
Q Consensus 161 --l~~~~~-d----------~~i~v~d~~~~~~~----------~~---------~~~-----~~~~~~~~~v~~~~~sp 203 (359)
|+.+|. . ..+..|-+.....- .. .+. .........|..+..||
T Consensus 160 ~LLlVgG~~~~~~~~s~a~~~GLtaWRiL~~~Pyyk~v~~~~~~~~~~~~~~~~~~~~~~~~fs~~~~~~d~i~kmSlSP 239 (282)
T PF15492_consen 160 RLLLVGGCEQNQDGMSKASSCGLTAWRILSDSPYYKQVTSSEDDITASSKRRGLLRIPSFKFFSRQGQEQDGIFKMSLSP 239 (282)
T ss_pred CEEEEeccCCCCCccccccccCceEEEEcCCCCcEEEccccCccccccccccceeeccceeeeeccccCCCceEEEEECC
Confidence 444442 1 13556654332110 00 000 00011234689999999
Q ss_pred CCCEEEEEeCCCeEEEEEc
Q 040274 204 YEDVLGIGHSMGWSGILVP 222 (359)
Q Consensus 204 ~~~~l~~g~~dg~~~i~~~ 222 (359)
||..|++.+.+|.+.+|.-
T Consensus 240 dg~~La~ih~sG~lsLW~i 258 (282)
T PF15492_consen 240 DGSLLACIHFSGSLSLWEI 258 (282)
T ss_pred CCCEEEEEEcCCeEEEEec
Confidence 9999999999998888854
No 259
>KOG4547 consensus WD40 repeat-containing protein [General function prediction only]
Probab=98.81 E-value=1.6e-07 Score=87.27 Aligned_cols=138 Identities=12% Similarity=0.138 Sum_probs=109.4
Q ss_pred CCCEEEEEeCCCeEEEEeCCCCcceEEee--cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee---cCCce
Q 040274 78 FNGVVSLGHSGGTVTMWKPTTSALLIKML--YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL---TGHAK 152 (359)
Q Consensus 78 ~~~~l~tg~~dg~v~lwd~~~~~~~~~~~--~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~---~~~v~ 152 (359)
+...++.|...|.|.+|+...++....+. +|.+.|+++.++.+-..|.+++.|+.+..|+......++.+ +..+.
T Consensus 69 ~t~~lvlgt~~g~v~~ys~~~g~it~~~st~~h~~~v~~~~~~~~~~ciyS~~ad~~v~~~~~~~~~~~~~~~~~~~~~~ 148 (541)
T KOG4547|consen 69 DTSMLVLGTPQGSVLLYSVAGGEITAKLSTDKHYGNVNEILDAQRLGCIYSVGADLKVVYILEKEKVIIRIWKEQKPLVS 148 (541)
T ss_pred CceEEEeecCCccEEEEEecCCeEEEEEecCCCCCcceeeecccccCceEecCCceeEEEEecccceeeeeeccCCCccc
Confidence 44578889999999999999998777766 79999999999999999999999999999999998888877 34579
Q ss_pred eEEEcCCCcEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccC-----CCEEEEEeC-CCeEEEE
Q 040274 153 TLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPY-----EDVLGIGHS-MGWSGIL 220 (359)
Q Consensus 153 ~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-----~~~l~~g~~-dg~~~i~ 220 (359)
+++++|||-+.+...+.|.+||+.+ .+.+..+.+|.+ +|.++.|.-+ |.+++++.. +..+.+|
T Consensus 149 sl~is~D~~~l~~as~~ik~~~~~~-kevv~~ftgh~s----~v~t~~f~~~~~g~~G~~vLssa~~~r~i~~w 217 (541)
T KOG4547|consen 149 SLCISPDGKILLTASRQIKVLDIET-KEVVITFTGHGS----PVRTLSFTTLIDGIIGKYVLSSAAAERGITVW 217 (541)
T ss_pred eEEEcCCCCEEEeccceEEEEEccC-ceEEEEecCCCc----ceEEEEEEEeccccccceeeeccccccceeEE
Confidence 9999999933333357999999654 477788888765 8999999877 666654433 3334443
No 260
>PF02239 Cytochrom_D1: Cytochrome D1 heme domain; PDB: 1NNO_B 1HZU_A 1N15_B 1N50_A 1GJQ_A 1BL9_B 1NIR_B 1N90_B 1HZV_A 1AOQ_A ....
Probab=98.79 E-value=4.3e-07 Score=84.04 Aligned_cols=139 Identities=13% Similarity=0.215 Sum_probs=92.5
Q ss_pred EEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec--CCceeEEEcCC
Q 040274 82 VSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT--GHAKTLDFSQK 159 (359)
Q Consensus 82 l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~--~~v~~~~~s~~ 159 (359)
+++-..+|.|.+.|..+.+.+..+......-..+.|+|||+++++++.||.|.++|+.+++.+.++. ....++++|+|
T Consensus 9 ~V~~~~~~~v~viD~~t~~~~~~i~~~~~~h~~~~~s~Dgr~~yv~~rdg~vsviD~~~~~~v~~i~~G~~~~~i~~s~D 88 (369)
T PF02239_consen 9 YVVERGSGSVAVIDGATNKVVARIPTGGAPHAGLKFSPDGRYLYVANRDGTVSVIDLATGKVVATIKVGGNPRGIAVSPD 88 (369)
T ss_dssp EEEEGGGTEEEEEETTT-SEEEEEE-STTEEEEEE-TT-SSEEEEEETTSEEEEEETTSSSEEEEEE-SSEEEEEEE--T
T ss_pred EEEecCCCEEEEEECCCCeEEEEEcCCCCceeEEEecCCCCEEEEEcCCCeEEEEECCcccEEEEEecCCCcceEEEcCC
Confidence 3455678999999999999999887654444557899999999999999999999999999998883 34688999999
Q ss_pred C-cEE-E-EcCCcEEEEcCCCCCccccccccccC---CCCcceeEEEEccCCCEEEEE-eCCCeEEEEE
Q 040274 160 G-LLA-V-GTGSFAQILGDFSGSHNYSRYMGNSM---VKGYQIGKVSFRPYEDVLGIG-HSMGWSGILV 221 (359)
Q Consensus 160 g-l~~-~-~~d~~i~v~d~~~~~~~~~~~~~~~~---~~~~~v~~~~~sp~~~~l~~g-~~dg~~~i~~ 221 (359)
| ++. + -..+.+.++|..+. +.+..+..... .....+..+..+|....+++. -+.+.+.++.
T Consensus 89 G~~~~v~n~~~~~v~v~D~~tl-e~v~~I~~~~~~~~~~~~Rv~aIv~s~~~~~fVv~lkd~~~I~vVd 156 (369)
T PF02239_consen 89 GKYVYVANYEPGTVSVIDAETL-EPVKTIPTGGMPVDGPESRVAAIVASPGRPEFVVNLKDTGEIWVVD 156 (369)
T ss_dssp TTEEEEEEEETTEEEEEETTT---EEEEEE--EE-TTTS---EEEEEE-SSSSEEEEEETTTTEEEEEE
T ss_pred CCEEEEEecCCCceeEeccccc-cceeecccccccccccCCCceeEEecCCCCEEEEEEccCCeEEEEE
Confidence 9 333 3 35799999996554 44444333211 022367888888988855544 4456555544
No 261
>KOG3914 consensus WD repeat protein WDR4 [Function unknown]
Probab=98.76 E-value=7.8e-08 Score=85.36 Aligned_cols=127 Identities=19% Similarity=0.260 Sum_probs=89.7
Q ss_pred eEEEECCCCCEEEEecc--------------------------ceeEEEEcCCCCEEEEEeCCC---eEEEEeCCCCcce
Q 040274 52 ILWILPSSGRYMAVAGR--------------------------RTDLMRVNPFNGVVSLGHSGG---TVTMWKPTTSALL 102 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~--------------------------~v~~l~~sp~~~~l~tg~~dg---~v~lwd~~~~~~~ 102 (359)
.....+++|++||.+.. ..+++.|..+......+..-| .+.+|....+.+
T Consensus 66 ~~~~~s~~~~llAv~~~~K~~~~f~~~~~~~~~kl~~~~~v~~~~~ai~~~~~~~sv~v~dkagD~~~~di~s~~~~~~- 144 (390)
T KOG3914|consen 66 ALVLTSDSGRLVAVATSSKQRAVFDYRENPKGAKLLDVSCVPKRPTAISFIREDTSVLVADKAGDVYSFDILSADSGRC- 144 (390)
T ss_pred cccccCCCceEEEEEeCCCceEEEEEecCCCcceeeeEeecccCcceeeeeeccceEEEEeecCCceeeeeecccccCc-
Confidence 55556677777766544 334444444444444443333 455555554443
Q ss_pred EEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee-cC---CceeEEEcCCC-cEEEEcCCcEEEEcCCC
Q 040274 103 IKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL-TG---HAKTLDFSQKG-LLAVGTGSFAQILGDFS 177 (359)
Q Consensus 103 ~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~-~~---~v~~~~~s~~g-l~~~~~d~~i~v~d~~~ 177 (359)
..+.||-+.++.++|+||+.+++|+..|..|++-....--.+.+| -| .|..++.-++- |+++|.|++|++||...
T Consensus 145 ~~~lGhvSml~dVavS~D~~~IitaDRDEkIRvs~ypa~f~IesfclGH~eFVS~isl~~~~~LlS~sGD~tlr~Wd~~s 224 (390)
T KOG3914|consen 145 EPILGHVSMLLDVAVSPDDQFIITADRDEKIRVSRYPATFVIESFCLGHKEFVSTISLTDNYLLLSGSGDKTLRLWDITS 224 (390)
T ss_pred chhhhhhhhhheeeecCCCCEEEEecCCceEEEEecCcccchhhhccccHhheeeeeeccCceeeecCCCCcEEEEeccc
Confidence 344599999999999999999999999999999877765556666 23 48899988888 89999999999999766
Q ss_pred CC
Q 040274 178 GS 179 (359)
Q Consensus 178 ~~ 179 (359)
+.
T Consensus 225 gk 226 (390)
T KOG3914|consen 225 GK 226 (390)
T ss_pred CC
Confidence 53
No 262
>COG4946 Uncharacterized protein related to the periplasmic component of the Tol biopolymer transport system [Function unknown]
Probab=98.74 E-value=8.1e-07 Score=80.68 Aligned_cols=139 Identities=12% Similarity=0.127 Sum_probs=106.0
Q ss_pred ceeEEEEcCCCCEEEEEeCCC-eEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGG-TVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg-~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~ 147 (359)
.|.-..+..++.-++.|..|| .+-|||..+++ +..+...-+.|.++..+|+|.+++.+.....|.+.|+.++.+...-
T Consensus 361 ~VrY~r~~~~~e~~vigt~dgD~l~iyd~~~~e-~kr~e~~lg~I~av~vs~dGK~~vvaNdr~el~vididngnv~~id 439 (668)
T COG4946 361 GVRYRRIQVDPEGDVIGTNDGDKLGIYDKDGGE-VKRIEKDLGNIEAVKVSPDGKKVVVANDRFELWVIDIDNGNVRLID 439 (668)
T ss_pred ceEEEEEccCCcceEEeccCCceEEEEecCCce-EEEeeCCccceEEEEEcCCCcEEEEEcCceEEEEEEecCCCeeEec
Confidence 677777777778899999999 89999999876 4455667889999999999999999999999999999998763322
Q ss_pred ---cCCceeEEEcCCC-cEEEEc-----CCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 148 ---TGHAKTLDFSQKG-LLAVGT-----GSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 148 ---~~~v~~~~~s~~g-l~~~~~-----d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
.+-|+.++|||++ +++-+. ...|++||+..+ +..... +.. +--.+-+|.|++++|..-+..
T Consensus 440 kS~~~lItdf~~~~nsr~iAYafP~gy~tq~Iklydm~~~-Kiy~vT-T~t----a~DfsPaFD~d~ryLYfLs~R 509 (668)
T COG4946 440 KSEYGLITDFDWHPNSRWIAYAFPEGYYTQSIKLYDMDGG-KIYDVT-TPT----AYDFSPAFDPDGRYLYFLSAR 509 (668)
T ss_pred ccccceeEEEEEcCCceeEEEecCcceeeeeEEEEecCCC-eEEEec-CCc----ccccCcccCCCCcEEEEEecc
Confidence 3568999999999 776664 358999997554 333221 111 134667899999998766543
No 263
>KOG3617 consensus WD40 and TPR repeat-containing protein [General function prediction only]
Probab=98.71 E-value=2.8e-07 Score=88.94 Aligned_cols=88 Identities=18% Similarity=0.258 Sum_probs=75.5
Q ss_pred eEEEECCCCCEEEEecc-------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML 106 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~ 106 (359)
.-.+|+|...+++.++. .+++++|+|..-.|+.|-.-|.+.+|...+.+......
T Consensus 19 ti~SWHPsePlfAVA~fS~er~GSVtIfadtGEPqr~Vt~P~hatSLCWHpe~~vLa~gwe~g~~~v~~~~~~e~htv~~ 98 (1416)
T KOG3617|consen 19 TISSWHPSEPLFAVASFSPERGGSVTIFADTGEPQRDVTYPVHATSLCWHPEEFVLAQGWEMGVSDVQKTNTTETHTVVE 98 (1416)
T ss_pred cccccCCCCceeEEEEecCCCCceEEEEecCCCCCcccccceehhhhccChHHHHHhhccccceeEEEecCCceeeeecc
Confidence 44567787777776654 67899999999899999999999999988877666666
Q ss_pred cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcC
Q 040274 107 YHQGPVSALAFHPNGHLMATTGKECKIKIWDLR 139 (359)
Q Consensus 107 ~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~ 139 (359)
.|..+|..+.|||+|..|+|+..-|.|.+|...
T Consensus 99 th~a~i~~l~wS~~G~~l~t~d~~g~v~lwr~d 131 (1416)
T KOG3617|consen 99 THPAPIQGLDWSHDGTVLMTLDNPGSVHLWRYD 131 (1416)
T ss_pred CCCCCceeEEecCCCCeEEEcCCCceeEEEEee
Confidence 899999999999999999999999999999654
No 264
>KOG2314 consensus Translation initiation factor 3, subunit b (eIF-3b) [Translation, ribosomal structure and biogenesis]
Probab=98.70 E-value=1.7e-07 Score=86.37 Aligned_cols=136 Identities=21% Similarity=0.306 Sum_probs=101.2
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecC-----------CCeEEEEE
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGK-----------ECKIKIWD 137 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~-----------d~~i~vwd 137 (359)
.-+.+.|||.|.||+|-+..| |.+|--.+...+..| .|.+ |.-+.|||+.+||+|-+. ...|.|||
T Consensus 212 Tetyv~wSP~GTYL~t~Hk~G-I~lWGG~~f~r~~RF-~Hp~-Vq~idfSP~EkYLVT~s~~p~~~~~~d~e~~~l~IWD 288 (698)
T KOG2314|consen 212 TETYVRWSPKGTYLVTFHKQG-IALWGGESFDRIQRF-YHPG-VQFIDFSPNEKYLVTYSPEPIIVEEDDNEGQQLIIWD 288 (698)
T ss_pred eeeeEEecCCceEEEEEeccc-eeeecCccHHHHHhc-cCCC-ceeeecCCccceEEEecCCccccCcccCCCceEEEEE
Confidence 678899999999999998765 679976655556665 5555 788999999999999553 15799999
Q ss_pred cCCCeeeEeecC---C---ceeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEE
Q 040274 138 LRKYEVLQTLTG---H---AKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGI 210 (359)
Q Consensus 138 ~~~~~~~~~~~~---~---v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~ 210 (359)
+++|....+|.. + -.-+.||.|+ +++.-..++|.||+... ...+..... .-..|....|||.+.+||-
T Consensus 289 I~tG~lkrsF~~~~~~~~~WP~frWS~DdKy~Arm~~~sisIyEtps----f~lld~Ksl-ki~gIr~FswsP~~~llAY 363 (698)
T KOG2314|consen 289 IATGLLKRSFPVIKSPYLKWPIFRWSHDDKYFARMTGNSISIYETPS----FMLLDKKSL-KISGIRDFSWSPTSNLLAY 363 (698)
T ss_pred ccccchhcceeccCCCccccceEEeccCCceeEEeccceEEEEecCc----eeeeccccc-CCccccCcccCCCcceEEE
Confidence 999998888732 1 2567899999 88887789999998532 222222222 1125888999999998884
Q ss_pred Ee
Q 040274 211 GH 212 (359)
Q Consensus 211 g~ 212 (359)
-+
T Consensus 364 wt 365 (698)
T KOG2314|consen 364 WT 365 (698)
T ss_pred Ec
Confidence 33
No 265
>PLN02919 haloacid dehalogenase-like hydrolase family protein
Probab=98.70 E-value=3.6e-06 Score=87.87 Aligned_cols=154 Identities=9% Similarity=-0.005 Sum_probs=102.4
Q ss_pred eEEEEcC-CCCEEEEEeCCCeEEEEeCCCCcceEEeecC---------------CCCeEEEEEecCCCE-EEEecCCCeE
Q 040274 71 DLMRVNP-FNGVVSLGHSGGTVTMWKPTTSALLIKMLYH---------------QGPVSALAFHPNGHL-MATTGKECKI 133 (359)
Q Consensus 71 ~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h---------------~~~v~~l~~~p~g~~-l~s~~~d~~i 133 (359)
+.++++| ++.++++.+.++.|++||+.++... .+.+. ....+.++|+|+|.. +++-+.++.|
T Consensus 686 ~gVa~dp~~g~LyVad~~~~~I~v~d~~~g~v~-~~~G~G~~~~~~g~~~~~~~~~~P~GIavspdG~~LYVADs~n~~I 764 (1057)
T PLN02919 686 WDVCFEPVNEKVYIAMAGQHQIWEYNISDGVTR-VFSGDGYERNLNGSSGTSTSFAQPSGISLSPDLKELYIADSESSSI 764 (1057)
T ss_pred eEEEEecCCCeEEEEECCCCeEEEEECCCCeEE-EEecCCccccCCCCccccccccCccEEEEeCCCCEEEEEECCCCeE
Confidence 4688888 5556677777889999998776432 22111 123467999999884 4555667899
Q ss_pred EEEEcCCCeeeEe-------------e-----------cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCcccccccc
Q 040274 134 KIWDLRKYEVLQT-------------L-----------TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMG 187 (359)
Q Consensus 134 ~vwd~~~~~~~~~-------------~-----------~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~ 187 (359)
++||+.++..... + -.+...++++++| +++-+.++.|++||..+. ... .+.+
T Consensus 765 rv~D~~tg~~~~~~gg~~~~~~~l~~fG~~dG~g~~~~l~~P~Gvavd~dG~LYVADs~N~rIrviD~~tg-~v~-tiaG 842 (1057)
T PLN02919 765 RALDLKTGGSRLLAGGDPTFSDNLFKFGDHDGVGSEVLLQHPLGVLCAKDGQIYVADSYNHKIKKLDPATK-RVT-TLAG 842 (1057)
T ss_pred EEEECCCCcEEEEEecccccCcccccccCCCCchhhhhccCCceeeEeCCCcEEEEECCCCEEEEEECCCC-eEE-EEec
Confidence 9999987543211 1 0134689999999 566667789999996443 221 1111
Q ss_pred ccC----------CCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCCC
Q 040274 188 NSM----------VKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSEP 227 (359)
Q Consensus 188 ~~~----------~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~~ 227 (359)
... ........++++++|+++++-+.++.|++|...++..
T Consensus 843 ~G~~G~~dG~~~~a~l~~P~GIavd~dG~lyVaDt~Nn~Irvid~~~~~~ 892 (1057)
T PLN02919 843 TGKAGFKDGKALKAQLSEPAGLALGENGRLFVADTNNSLIRYLDLNKGEA 892 (1057)
T ss_pred cCCcCCCCCcccccccCCceEEEEeCCCCEEEEECCCCEEEEEECCCCcc
Confidence 100 0112467899999999888888999999998766553
No 266
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=98.69 E-value=8.4e-06 Score=75.15 Aligned_cols=164 Identities=12% Similarity=0.141 Sum_probs=106.2
Q ss_pred ceeEEEEcCCCCEEEEEeC----CCeEEEEeCCCC--c--ceEEeecCCCCeEEEEEecCCCEEEEec-CCCeEEEEEcC
Q 040274 69 RTDLMRVNPFNGVVSLGHS----GGTVTMWKPTTS--A--LLIKMLYHQGPVSALAFHPNGHLMATTG-KECKIKIWDLR 139 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~----dg~v~lwd~~~~--~--~~~~~~~h~~~v~~l~~~p~g~~l~s~~-~d~~i~vwd~~ 139 (359)
..+.|+++|++.+|++++. +|.|..|++... . .+............++++|++++|+++. .+|.|.++++.
T Consensus 38 ~Ps~l~~~~~~~~LY~~~e~~~~~g~v~~~~i~~~~g~L~~~~~~~~~g~~p~~i~~~~~g~~l~vany~~g~v~v~~l~ 117 (345)
T PF10282_consen 38 NPSWLAVSPDGRRLYVVNEGSGDSGGVSSYRIDPDTGTLTLLNSVPSGGSSPCHIAVDPDGRFLYVANYGGGSVSVFPLD 117 (345)
T ss_dssp SECCEEE-TTSSEEEEEETTSSTTTEEEEEEEETTTTEEEEEEEEEESSSCEEEEEECTTSSEEEEEETTTTEEEEEEEC
T ss_pred CCceEEEEeCCCEEEEEEccccCCCCEEEEEECCCcceeEEeeeeccCCCCcEEEEEecCCCEEEEEEccCCeEEEEEcc
Confidence 6788999999999998876 578999987754 2 3333433344557799999999988887 58999999998
Q ss_pred C-CeeeE---ee-------------cCCceeEEEcCCC--cEEEEc-CCcEEEEcCCCCCccccccccccCCCCcceeEE
Q 040274 140 K-YEVLQ---TL-------------TGHAKTLDFSQKG--LLAVGT-GSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKV 199 (359)
Q Consensus 140 ~-~~~~~---~~-------------~~~v~~~~~s~~g--l~~~~~-d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~ 199 (359)
. +.... .+ ..++.++.|+|+| ++++.. ...|.+|++......+........+.+.....+
T Consensus 118 ~~g~l~~~~~~~~~~g~g~~~~rq~~~h~H~v~~~pdg~~v~v~dlG~D~v~~~~~~~~~~~l~~~~~~~~~~G~GPRh~ 197 (345)
T PF10282_consen 118 DDGSLGEVVQTVRHEGSGPNPDRQEGPHPHQVVFSPDGRFVYVPDLGADRVYVYDIDDDTGKLTPVDSIKVPPGSGPRHL 197 (345)
T ss_dssp TTSEEEEEEEEEESEEEESSTTTTSSTCEEEEEE-TTSSEEEEEETTTTEEEEEEE-TTS-TEEEEEEEECSTTSSEEEE
T ss_pred CCcccceeeeecccCCCCCcccccccccceeEEECCCCCEEEEEecCCCEEEEEEEeCCCceEEEeeccccccCCCCcEE
Confidence 6 43221 11 1356899999999 444333 468999986554322222111112245568999
Q ss_pred EEccCCCEEEEEeC-CCeEEEEEcCCCCCceeee
Q 040274 200 SFRPYEDVLGIGHS-MGWSGILVPRSSEPNFDSW 232 (359)
Q Consensus 200 ~~sp~~~~l~~g~~-dg~~~i~~~gs~~~~~~~~ 232 (359)
.|+|+++++++.+. ++.+.++.....++.+...
T Consensus 198 ~f~pdg~~~Yv~~e~s~~v~v~~~~~~~g~~~~~ 231 (345)
T PF10282_consen 198 AFSPDGKYAYVVNELSNTVSVFDYDPSDGSLTEI 231 (345)
T ss_dssp EE-TTSSEEEEEETTTTEEEEEEEETTTTEEEEE
T ss_pred EEcCCcCEEEEecCCCCcEEEEeecccCCceeEE
Confidence 99999998877665 5667776555344444433
No 267
>KOG1334 consensus WD40 repeat protein [General function prediction only]
Probab=98.65 E-value=2.6e-07 Score=84.00 Aligned_cols=167 Identities=14% Similarity=0.140 Sum_probs=115.3
Q ss_pred eEEEECCCCCEEEEecc------------------------ceeEEEEcC--CCCEEEEEeCCCeEEEEeCC-CCcc--e
Q 040274 52 ILWILPSSGRYMAVAGR------------------------RTDLMRVNP--FNGVVSLGHSGGTVTMWKPT-TSAL--L 102 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------~v~~l~~sp--~~~~l~tg~~dg~v~lwd~~-~~~~--~ 102 (359)
..+.|...|..|++|+. .|.--.|-| +...|++++.||.|++=.+. ++.+ .
T Consensus 146 ntV~FN~~Gd~l~SgSDD~~vv~WdW~~~~~~l~f~SGH~~NvfQaKFiP~s~d~ti~~~s~dgqvr~s~i~~t~~~e~t 225 (559)
T KOG1334|consen 146 NTVHFNQRGDVLASGSDDLQVVVWDWVSGSPKLSFESGHCNNVFQAKFIPFSGDRTIVTSSRDGQVRVSEILETGYVENT 225 (559)
T ss_pred ceeeecccCceeeccCccceEEeehhhccCcccccccccccchhhhhccCCCCCcCceeccccCceeeeeeccccceecc
Confidence 78888899999999987 444445666 34578899999999987754 3332 2
Q ss_pred EEeecCCCCeEEEEEecCCC-EEEEecCCCeEEEEEcCCCeeeEee------cC---CceeEEEcCCC---cEEEEcCCc
Q 040274 103 IKMLYHQGPVSALAFHPNGH-LMATTGKECKIKIWDLRKYEVLQTL------TG---HAKTLDFSQKG---LLAVGTGSF 169 (359)
Q Consensus 103 ~~~~~h~~~v~~l~~~p~g~-~l~s~~~d~~i~vwd~~~~~~~~~~------~~---~v~~~~~s~~g---l~~~~~d~~ 169 (359)
..+..|.++|+-++.-|+.. -|.+++.|+.+.-+|++...+...+ .. ...+++..|.. +.+++.|..
T Consensus 226 ~rl~~h~g~vhklav~p~sp~~f~S~geD~~v~~~Dlr~~~pa~~~~cr~~~~~~~v~L~~Ia~~P~nt~~faVgG~dqf 305 (559)
T KOG1334|consen 226 KRLAPHEGPVHKLAVEPDSPKPFLSCGEDAVVFHIDLRQDVPAEKFVCREADEKERVGLYTIAVDPRNTNEFAVGGSDQF 305 (559)
T ss_pred eecccccCccceeeecCCCCCcccccccccceeeeeeccCCccceeeeeccCCccceeeeeEecCCCCccccccCChhhh
Confidence 34557999999999999654 5999999999999999987654333 11 24788888876 677888999
Q ss_pred EEEEcCCCCCcc-----ccccccccC--CCCcceeEEEEccCCCEEEEEeCCCeEE
Q 040274 170 AQILGDFSGSHN-----YSRYMGNSM--VKGYQIGKVSFRPYEDVLGIGHSMGWSG 218 (359)
Q Consensus 170 i~v~d~~~~~~~-----~~~~~~~~~--~~~~~v~~~~~sp~~~~l~~g~~dg~~~ 218 (359)
+++||.+.-... +..+..|.. .....|++++|+.++.-|+++..|-.+.
T Consensus 306 ~RvYD~R~~~~e~~n~~~~~f~p~hl~~d~~v~ITgl~Ysh~~sElLaSYnDe~IY 361 (559)
T KOG1334|consen 306 ARVYDQRRIDKEENNGVLDKFCPHHLVEDDPVNITGLVYSHDGSELLASYNDEDIY 361 (559)
T ss_pred hhhhcccchhhccccchhhhcCCccccccCcccceeEEecCCccceeeeecccceE
Confidence 999996543211 111111111 0223599999998776666555554433
No 268
>KOG1354 consensus Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=98.64 E-value=3.1e-07 Score=80.15 Aligned_cols=126 Identities=16% Similarity=0.181 Sum_probs=94.9
Q ss_pred eEEEECCCCCEEEEecc------------------------------ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCCc
Q 040274 52 ILWILPSSGRYMAVAGR------------------------------RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTSA 100 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------------~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~ 100 (359)
.++.+..|+..++++.. -|++-.||| ..++|+..+..|+|++.|++...
T Consensus 168 NSIS~NsD~Et~lSADdLRINLWnlei~d~sFnIVDIKP~nmEeLteVITsaEFhp~~cn~f~YSSSKGtIrLcDmR~~a 247 (433)
T KOG1354|consen 168 NSISVNSDKETFLSADDLRINLWNLEIIDQSFNIVDIKPANMEELTEVITSAEFHPHHCNVFVYSSSKGTIRLCDMRQSA 247 (433)
T ss_pred eeeeecCccceEeeccceeeeeccccccCCceeEEEccccCHHHHHHHHhhhccCHhHccEEEEecCCCcEEEeechhhh
Confidence 88999999999999877 689999999 56789999999999999998432
Q ss_pred ce----EEee------------cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC-CeeeEeec---------------
Q 040274 101 LL----IKML------------YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRK-YEVLQTLT--------------- 148 (359)
Q Consensus 101 ~~----~~~~------------~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~-~~~~~~~~--------------- 148 (359)
.- ..+. .-...|..+.|+++|+|+++-+. -+|++||+.. .+++.+++
T Consensus 248 LCd~hsKlfEepedp~~rsffseiIsSISDvKFs~sGryilsRDy-ltvk~wD~nme~~pv~t~~vh~~lr~kLc~lYEn 326 (433)
T KOG1354|consen 248 LCDAHSKLFEEPEDPSSRSFFSEIISSISDVKFSHSGRYILSRDY-LTVKLWDLNMEAKPVETYPVHEYLRSKLCSLYEN 326 (433)
T ss_pred hhcchhhhhccccCCcchhhHHHHhhhhhceEEccCCcEEEEecc-ceeEEEeccccCCcceEEeehHhHHHHHHHHhhc
Confidence 10 0011 11246788999999999988643 5799999954 45555552
Q ss_pred CCc---eeEEEcCCC--cEEEEcCCcEEEEcCCCC
Q 040274 149 GHA---KTLDFSQKG--LLAVGTGSFAQILGDFSG 178 (359)
Q Consensus 149 ~~v---~~~~~s~~g--l~~~~~d~~i~v~d~~~~ 178 (359)
+.| ..++|+.++ .++|++.+.+++|+...+
T Consensus 327 D~IfdKFec~~sg~~~~v~TGsy~n~frvf~~~~g 361 (433)
T KOG1354|consen 327 DAIFDKFECSWSGNDSYVMTGSYNNVFRVFNLARG 361 (433)
T ss_pred cchhheeEEEEcCCcceEecccccceEEEecCCCC
Confidence 122 568899987 788999999999995443
No 269
>PRK04043 tolB translocation protein TolB; Provisional
Probab=98.63 E-value=5.4e-06 Score=78.17 Aligned_cols=137 Identities=12% Similarity=0.029 Sum_probs=87.7
Q ss_pred ceeEEEEcCCCCE-EEEEeCC---CeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEe-cC--CCeEEEEEcCCC
Q 040274 69 RTDLMRVNPFNGV-VSLGHSG---GTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATT-GK--ECKIKIWDLRKY 141 (359)
Q Consensus 69 ~v~~l~~sp~~~~-l~tg~~d---g~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~-~~--d~~i~vwd~~~~ 141 (359)
.+....|+|+|+. ++..+.+ ..|.++|+.+++..... ...+.+.+..|+|||+.++.. +. +..|+++|+.++
T Consensus 189 ~~~~p~wSpDG~~~i~y~s~~~~~~~Iyv~dl~tg~~~~lt-~~~g~~~~~~~SPDG~~la~~~~~~g~~~Iy~~dl~~g 267 (419)
T PRK04043 189 LNIFPKWANKEQTAFYYTSYGERKPTLYKYNLYTGKKEKIA-SSQGMLVVSDVSKDGSKLLLTMAPKGQPDIYLYDTNTK 267 (419)
T ss_pred CeEeEEECCCCCcEEEEEEccCCCCEEEEEECCCCcEEEEe-cCCCcEEeeEECCCCCEEEEEEccCCCcEEEEEECCCC
Confidence 5678999999984 6654433 46999999888654433 345667778999999876543 33 357888898877
Q ss_pred eeeEee--cCCceeEEEcCCC--cEEEEc-CC--cEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 142 EVLQTL--TGHAKTLDFSQKG--LLAVGT-GS--FAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 142 ~~~~~~--~~~v~~~~~s~~g--l~~~~~-d~--~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
...... .+......|+||| ++..+. .+ .|+++|+..+ ....... . + .....|+|||++|+..+..
T Consensus 268 ~~~~LT~~~~~d~~p~~SPDG~~I~F~Sdr~g~~~Iy~~dl~~g-~~~rlt~-~-g-----~~~~~~SPDG~~Ia~~~~~ 339 (419)
T PRK04043 268 TLTQITNYPGIDVNGNFVEDDKRIVFVSDRLGYPNIFMKKLNSG-SVEQVVF-H-G-----KNNSSVSTYKNYIVYSSRE 339 (419)
T ss_pred cEEEcccCCCccCccEECCCCCEEEEEECCCCCceEEEEECCCC-CeEeCcc-C-C-----CcCceECCCCCEEEEEEcC
Confidence 643322 3334567899999 443332 23 6777776443 2212111 1 1 1124899999998877654
No 270
>KOG4714 consensus Nucleoporin [Nuclear structure]
Probab=98.62 E-value=1.7e-07 Score=78.77 Aligned_cols=72 Identities=21% Similarity=0.419 Sum_probs=63.0
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCCcc-eEEeecCCCCeEEEEEec-CCCEEEEecCCCeEEEEEcCC
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTSAL-LIKMLYHQGPVSALAFHP-NGHLMATTGKECKIKIWDLRK 140 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~~-~~~~~~h~~~v~~l~~~p-~g~~l~s~~~d~~i~vwd~~~ 140 (359)
.|++++-+| ...++++|+.||.|.+||.+.... ...+..|..+++-+-|+| ++..|++++.||.+..||..+
T Consensus 181 ~v~~l~~hp~qq~~v~cgt~dg~~~l~d~rn~~~p~S~l~ahk~~i~eV~FHpk~p~~Lft~sedGslw~wdas~ 255 (319)
T KOG4714|consen 181 AVTALCSHPAQQHLVCCGTDDGIVGLWDARNVAMPVSLLKAHKAEIWEVHFHPKNPEHLFTCSEDGSLWHWDAST 255 (319)
T ss_pred cchhhhCCcccccEEEEecCCCeEEEEEcccccchHHHHHHhhhhhhheeccCCCchheeEecCCCcEEEEcCCC
Confidence 799999999 667888999999999999987743 445669999999999999 778899999999999999875
No 271
>KOG4190 consensus Uncharacterized conserved protein [Function unknown]
Probab=98.61 E-value=1.4e-07 Score=87.07 Aligned_cols=161 Identities=17% Similarity=0.212 Sum_probs=111.9
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCC-------CCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCC
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPT-------TSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKY 141 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~-------~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~ 141 (359)
.|..+.--.+.+.+++++.|.+|.+|.+. |..+..++..|..+|+++.|-.+-++++++ ||.|.+||.--+
T Consensus 737 ~iRai~AidNENSFiSASkDKTVKLWSik~EgD~~~tsaCQfTY~aHkk~i~~igfL~~lr~i~Sc--D~giHlWDPFig 814 (1034)
T KOG4190|consen 737 KIRAIAAIDNENSFISASKDKTVKLWSIKPEGDEIGTSACQFTYQAHKKPIHDIGFLADLRSIASC--DGGIHLWDPFIG 814 (1034)
T ss_pred HhHHHHhcccccceeeccCCceEEEEEeccccCccccceeeeEhhhccCcccceeeeeccceeeec--cCcceeeccccc
Confidence 34444433455678899999999999976 334777888999999999999988877765 788999998877
Q ss_pred eeeEee-----cCCceeEEEcCC--C--cEEE-EcCCcEEEEcCCCCCcccccccc-ccCCCCcceeEEEEccCCCEEEE
Q 040274 142 EVLQTL-----TGHAKTLDFSQK--G--LLAV-GTGSFAQILGDFSGSHNYSRYMG-NSMVKGYQIGKVSFRPYEDVLGI 210 (359)
Q Consensus 142 ~~~~~~-----~~~v~~~~~s~~--g--l~~~-~~d~~i~v~d~~~~~~~~~~~~~-~~~~~~~~v~~~~~sp~~~~l~~ 210 (359)
.++... .+.+..+..-++ . ++++ +...+|.++|.+..+.....-.. ..+ +...+.+++..|.|++++.
T Consensus 815 r~Laq~~dapk~~a~~~ikcl~nv~~~iliAgcsaeSTVKl~DaRsce~~~E~kVcna~~-Pna~~R~iaVa~~GN~lAa 893 (1034)
T KOG4190|consen 815 RLLAQMEDAPKEGAGGNIKCLENVDRHILIAGCSAESTVKLFDARSCEWTCELKVCNAPG-PNALTRAIAVADKGNKLAA 893 (1034)
T ss_pred chhHhhhcCcccCCCceeEecccCcchheeeeccchhhheeeecccccceeeEEeccCCC-CchheeEEEeccCcchhhH
Confidence 776544 233334433343 2 4444 45689999996654332221111 122 4457899999999999999
Q ss_pred EeCCCeEEEEEcCCCCCceeeec
Q 040274 211 GHSMGWSGILVPRSSEPNFDSWV 233 (359)
Q Consensus 211 g~~dg~~~i~~~gs~~~~~~~~~ 233 (359)
|-++|.+.++..-.|- .|..|.
T Consensus 894 ~LSnGci~~LDaR~G~-vINswr 915 (1034)
T KOG4190|consen 894 ALSNGCIAILDARNGK-VINSWR 915 (1034)
T ss_pred HhcCCcEEEEecCCCc-eeccCC
Confidence 9999998888765442 355553
No 272
>KOG4547 consensus WD40 repeat-containing protein [General function prediction only]
Probab=98.57 E-value=2.6e-06 Score=79.28 Aligned_cols=107 Identities=20% Similarity=0.215 Sum_probs=90.2
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
.|+++.++.+-..|.+++.|+.|..|+......+..+.+....+.+++++|||..+++++ +.|++||+.+++.+.+|.
T Consensus 104 ~v~~~~~~~~~~ciyS~~ad~~v~~~~~~~~~~~~~~~~~~~~~~sl~is~D~~~l~~as--~~ik~~~~~~kevv~~ft 181 (541)
T KOG4547|consen 104 NVNEILDAQRLGCIYSVGADLKVVYILEKEKVIIRIWKEQKPLVSSLCISPDGKILLTAS--RQIKVLDIETKEVVITFT 181 (541)
T ss_pred cceeeecccccCceEecCCceeEEEEecccceeeeeeccCCCccceEEEcCCCCEEEecc--ceEEEEEccCceEEEEec
Confidence 799999999888999999999999999999999999999999999999999999999886 689999999999999996
Q ss_pred CC---ceeEEEcCC-----C-cEEEE--cCCcEEEEcCCC
Q 040274 149 GH---AKTLDFSQK-----G-LLAVG--TGSFAQILGDFS 177 (359)
Q Consensus 149 ~~---v~~~~~s~~-----g-l~~~~--~d~~i~v~d~~~ 177 (359)
+| |++++|.-+ | ++..+ .+..+.+|-+..
T Consensus 182 gh~s~v~t~~f~~~~~g~~G~~vLssa~~~r~i~~w~v~~ 221 (541)
T KOG4547|consen 182 GHGSPVRTLSFTTLIDGIIGKYVLSSAAAERGITVWVVEK 221 (541)
T ss_pred CCCcceEEEEEEEeccccccceeeeccccccceeEEEEEc
Confidence 54 688888665 4 33222 345677776543
No 273
>KOG1240 consensus Protein kinase containing WD40 repeats [Signal transduction mechanisms]
Probab=98.57 E-value=2.4e-06 Score=85.75 Aligned_cols=156 Identities=10% Similarity=0.107 Sum_probs=98.0
Q ss_pred eeEEEEcC-CCC-EEEEEeCCCeEEEEeCCCCcceEEee--cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeE
Q 040274 70 TDLMRVNP-FNG-VVSLGHSGGTVTMWKPTTSALLIKML--YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQ 145 (359)
Q Consensus 70 v~~l~~sp-~~~-~l~tg~~dg~v~lwd~~~~~~~~~~~--~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~ 145 (359)
|.+-+|.. ... .++.+...+.|..||+++...+..++ ...|.|++++.+|.++.++.|+..|.+-+||+|=+.++.
T Consensus 1152 v~m~a~~~~~~S~~lvy~T~~~~iv~~D~r~~~~~w~lk~~~~hG~vTSi~idp~~~WlviGts~G~l~lWDLRF~~~i~ 1231 (1431)
T KOG1240|consen 1152 VSMHAFTAIVQSHVLVYATDLSRIVSWDTRMRHDAWRLKNQLRHGLVTSIVIDPWCNWLVIGTSRGQLVLWDLRFRVPIL 1231 (1431)
T ss_pred EEeecccccccceeEEEEEeccceEEecchhhhhHHhhhcCccccceeEEEecCCceEEEEecCCceEEEEEeecCceee
Confidence 34444433 233 67888888899999999876666554 456889999999999999999999999999999888887
Q ss_pred eec----CCceeEEEcC---CC--cEEEEc--CCcEEEEcCCCCCcccccccc-------ccC-------CCCcceeEEE
Q 040274 146 TLT----GHAKTLDFSQ---KG--LLAVGT--GSFAQILGDFSGSHNYSRYMG-------NSM-------VKGYQIGKVS 200 (359)
Q Consensus 146 ~~~----~~v~~~~~s~---~g--l~~~~~--d~~i~v~d~~~~~~~~~~~~~-------~~~-------~~~~~v~~~~ 200 (359)
++. .++..+..+| .. .++++. .+.|.+|++.++......... +.. ++.-....+.
T Consensus 1232 sw~~P~~~~i~~v~~~~~~~~~S~~vs~~~~~~nevs~wn~~~g~~~~vl~~s~~~p~ls~~~Ps~~~~kp~~~~~~~~~ 1311 (1431)
T KOG1240|consen 1232 SWEHPARAPIRHVWLCPTYPQESVSVSAGSSSNNEVSTWNMETGLRQTVLWASDGAPILSYALPSNDARKPDSLAGISCG 1311 (1431)
T ss_pred cccCcccCCcceEEeeccCCCCceEEEecccCCCceeeeecccCcceEEEEcCCCCcchhhhcccccCCCCCcccceeee
Confidence 772 2344444433 22 444443 578999997765322111111 111 0111122233
Q ss_pred EccCCCEEEEEeCCCeEEEEEcCCC
Q 040274 201 FRPYEDVLGIGHSMGWSGILVPRSS 225 (359)
Q Consensus 201 ~sp~~~~l~~g~~dg~~~i~~~gs~ 225 (359)
+..-+.++++|+.|+.++.|.+...
T Consensus 1312 ~~~~~~~~ltggsd~kIR~wD~~~p 1336 (1431)
T KOG1240|consen 1312 VCEKNGFLLTGGSDMKIRKWDPTRP 1336 (1431)
T ss_pred cccCCceeeecCCccceeeccCCCc
Confidence 4444556677777776666655443
No 274
>KOG0309 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=98.55 E-value=1.6e-07 Score=89.35 Aligned_cols=165 Identities=16% Similarity=0.260 Sum_probs=123.0
Q ss_pred eEEEECCCCCEEEEecc------------------------ceeEEEEcCCCC---EEEEEeCCCeEEEEeCCCC---cc
Q 040274 52 ILWILPSSGRYMAVAGR------------------------RTDLMRVNPFNG---VVSLGHSGGTVTMWKPTTS---AL 101 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------~v~~l~~sp~~~---~l~tg~~dg~v~lwd~~~~---~~ 101 (359)
..+.++|.|+-++++++ .|....|+|... ++++.+ +..-.+|++... ..
T Consensus 28 ~a~si~p~grdi~lAsr~gl~i~dld~p~~ppr~l~h~tpw~vad~qws~h~a~~~wiVsts-~qkaiiwnlA~ss~~aI 106 (1081)
T KOG0309|consen 28 NAVSINPSGRDIVLASRQGLYIIDLDDPFTPPRWLHHITPWQVADVQWSPHPAKPYWIVSTS-NQKAIIWNLAKSSSNAI 106 (1081)
T ss_pred cceeeccccchhhhhhhcCeEEEeccCCCCCceeeeccCcchhcceecccCCCCceeEEecC-cchhhhhhhhcCCccce
Confidence 55677788888877776 677888888543 344444 445568987532 33
Q ss_pred eEEeecCCCCeEEEEEecCC-CEEEEecCCCeEEEEEcCCCe-eeEee---cCCceeEEEcCCC--cEEEEcCCcEEEEc
Q 040274 102 LIKMLYHQGPVSALAFHPNG-HLMATTGKECKIKIWDLRKYE-VLQTL---TGHAKTLDFSQKG--LLAVGTGSFAQILG 174 (359)
Q Consensus 102 ~~~~~~h~~~v~~l~~~p~g-~~l~s~~~d~~i~vwd~~~~~-~~~~~---~~~v~~~~~s~~g--l~~~~~d~~i~v~d 174 (359)
...+.+|...|+.+.|+|.. ..+++++.|..+..||+++.. ++..+ ....+.+.|+-.. +++.+.++.|.+||
T Consensus 107 ef~lhghsraitd~n~~~q~pdVlatcsvdt~vh~wd~rSp~~p~ys~~~w~s~asqVkwnyk~p~vlasshg~~i~vwd 186 (1081)
T KOG0309|consen 107 EFVLHGHSRAITDINFNPQHPDVLATCSVDTYVHAWDMRSPHRPFYSTSSWRSAASQVKWNYKDPNVLASSHGNDIFVWD 186 (1081)
T ss_pred EEEEecCccceeccccCCCCCcceeeccccccceeeeccCCCcceeeeecccccCceeeecccCcchhhhccCCceEEEe
Confidence 44566999999999999954 468999999999999999853 55555 4457889998755 88888899999999
Q ss_pred CCCCCccccccccccCCCCcceeEEEEccC-CCEEEEEeCCCeEEEEE
Q 040274 175 DFSGSHNYSRYMGNSMVKGYQIGKVSFRPY-EDVLGIGHSMGWSGILV 221 (359)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-~~~l~~g~~dg~~~i~~ 221 (359)
++.+..+...+.+|.. .|+++.|... ...+.+.+.||++.+|.
T Consensus 187 ~r~gs~pl~s~K~~vs----~vn~~~fnr~~~s~~~s~~~d~tvkfw~ 230 (1081)
T KOG0309|consen 187 LRKGSTPLCSLKGHVS----SVNSIDFNRFKYSEIMSSSNDGTVKFWD 230 (1081)
T ss_pred ccCCCcceEEecccce----eeehHHHhhhhhhhhcccCCCCceeeec
Confidence 9888877777777644 6888887763 34577788888887764
No 275
>KOG4532 consensus WD40-like repeat containing protein [General function prediction only]
Probab=98.55 E-value=6.9e-06 Score=69.65 Aligned_cols=142 Identities=11% Similarity=0.083 Sum_probs=92.4
Q ss_pred EEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCC-e-eeEee----cCCceeEE
Q 040274 82 VSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKY-E-VLQTL----TGHAKTLD 155 (359)
Q Consensus 82 l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~-~-~~~~~----~~~v~~~~ 155 (359)
+..++.|.++.+.++.-+..-..+.-..-.+++++++++++++++.+....|..|.+... + .+... .++-.+..
T Consensus 131 ~~i~sndht~k~~~~~~~s~~~~~h~~~~~~ns~~~snd~~~~~~Vgds~~Vf~y~id~~sey~~~~~~a~t~D~gF~~S 210 (344)
T KOG4532|consen 131 LNIASNDHTGKTMVVSGDSNKFAVHNQNLTQNSLHYSNDPSWGSSVGDSRRVFRYAIDDESEYIENIYEAPTSDHGFYNS 210 (344)
T ss_pred eeeccCCcceeEEEEecCcccceeeccccceeeeEEcCCCceEEEecCCCcceEEEeCCccceeeeeEecccCCCceeee
Confidence 445666777777766543222211111233889999999999999999999999988753 2 23323 35567889
Q ss_pred EcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCC--CEEEEEeCCCeEEEEEcC
Q 040274 156 FSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYE--DVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 156 ~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~--~~l~~g~~dg~~~i~~~g 223 (359)
|+... ++++..||++.|||++....+........-.|.+.+..+.|+|.| ++|...-.-+++.++..-
T Consensus 211 ~s~~~~~FAv~~Qdg~~~I~DVR~~~tpm~~~sstrp~hnGa~R~c~Fsl~g~lDLLf~sEhfs~~hv~D~R 282 (344)
T KOG4532|consen 211 FSENDLQFAVVFQDGTCAIYDVRNMATPMAEISSTRPHHNGAFRVCRFSLYGLLDLLFISEHFSRVHVVDTR 282 (344)
T ss_pred eccCcceEEEEecCCcEEEEEecccccchhhhcccCCCCCCceEEEEecCCCcceEEEEecCcceEEEEEcc
Confidence 99887 777888999999998776443332221111145589999999977 344444444555555443
No 276
>KOG1334 consensus WD40 repeat protein [General function prediction only]
Probab=98.53 E-value=2.5e-07 Score=84.12 Aligned_cols=151 Identities=13% Similarity=0.207 Sum_probs=116.7
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee-cCCCCeEEEEEec--CCCEEEEecCCCeEEEEEcCC-Cee-
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML-YHQGPVSALAFHP--NGHLMATTGKECKIKIWDLRK-YEV- 143 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~-~h~~~v~~l~~~p--~g~~l~s~~~d~~i~vwd~~~-~~~- 143 (359)
-|+.+.|+..|..|++|+.|..|.+||..++.+...|. +|...|....|-| +...+++++.||.|++=.+.. +.+
T Consensus 144 cVntV~FN~~Gd~l~SgSDD~~vv~WdW~~~~~~l~f~SGH~~NvfQaKFiP~s~d~ti~~~s~dgqvr~s~i~~t~~~e 223 (559)
T KOG1334|consen 144 CVNTVHFNQRGDVLASGSDDLQVVVWDWVSGSPKLSFESGHCNNVFQAKFIPFSGDRTIVTSSRDGQVRVSEILETGYVE 223 (559)
T ss_pred ccceeeecccCceeeccCccceEEeehhhccCcccccccccccchhhhhccCCCCCcCceeccccCceeeeeecccccee
Confidence 68999999999999999999999999999988887776 7998998888988 456799999999999877653 222
Q ss_pred ----eEeecCCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCC---cceeEEEEccCCC-EEEEEe
Q 040274 144 ----LQTLTGHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKG---YQIGKVSFRPYED-VLGIGH 212 (359)
Q Consensus 144 ----~~~~~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~---~~v~~~~~sp~~~-~l~~g~ 212 (359)
+....++|.-++.-|+. +++++.|+.+.-+|++... ....+..... .. -..++++..|... .+++|+
T Consensus 224 ~t~rl~~h~g~vhklav~p~sp~~f~S~geD~~v~~~Dlr~~~-pa~~~~cr~~-~~~~~v~L~~Ia~~P~nt~~faVgG 301 (559)
T KOG1334|consen 224 NTKRLAPHEGPVHKLAVEPDSPKPFLSCGEDAVVFHIDLRQDV-PAEKFVCREA-DEKERVGLYTIAVDPRNTNEFAVGG 301 (559)
T ss_pred cceecccccCccceeeecCCCCCcccccccccceeeeeeccCC-ccceeeeecc-CCccceeeeeEecCCCCccccccCC
Confidence 33336788888888877 9999999999999976542 2222222111 11 2567889999775 788999
Q ss_pred CCCeEEEEE
Q 040274 213 SMGWSGILV 221 (359)
Q Consensus 213 ~dg~~~i~~ 221 (359)
.|-+.++|.
T Consensus 302 ~dqf~RvYD 310 (559)
T KOG1334|consen 302 SDQFARVYD 310 (559)
T ss_pred hhhhhhhhc
Confidence 998888764
No 277
>KOG2041 consensus WD40 repeat protein [General function prediction only]
Probab=98.53 E-value=3.7e-07 Score=86.62 Aligned_cols=145 Identities=14% Similarity=0.183 Sum_probs=106.5
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCc---------------ceEEeecCCCCeEEEEEecCCCEEEEecCCCeE
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSA---------------LLIKMLYHQGPVSALAFHPNGHLMATTGKECKI 133 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~---------------~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i 133 (359)
..+|+.|+....+|++|+.||.+.+..+.+.. .-+++.||.+.|..+.|+.+...|-|+..+|.|
T Consensus 16 kL~c~~WNke~gyIAcgG~dGlLKVlKl~t~t~d~~~~glaa~snLsmNQtLeGH~~sV~vvTWNe~~QKLTtSDt~GlI 95 (1189)
T KOG2041|consen 16 KLHCAEWNKESGYIACGGADGLLKVLKLGTDTTDLNKSGLAAASNLSMNQTLEGHNASVMVVTWNENNQKLTTSDTSGLI 95 (1189)
T ss_pred eEEEEEEcccCCeEEeccccceeEEEEccccCCcccccccccccccchhhhhccCcceEEEEEeccccccccccCCCceE
Confidence 46899999999999999999999998765432 123567999999999999999999999999999
Q ss_pred EEEEcCCCeeeEee-----cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCcccc-ccccccCCCCcceeEEEEccCC
Q 040274 134 KIWDLRKYEVLQTL-----TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYS-RYMGNSMVKGYQIGKVSFRPYE 205 (359)
Q Consensus 134 ~vwd~~~~~~~~~~-----~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~-~~~~~~~~~~~~v~~~~~sp~~ 205 (359)
.||-+-.++-.-.+ .+-|.+++|+.+| +..+-.||.|.|=.+ .+..... .+.+ .....+.|++|.
T Consensus 96 iVWmlykgsW~EEMiNnRnKSvV~SmsWn~dG~kIcIvYeDGavIVGsv-dGNRIwgKeLkg------~~l~hv~ws~D~ 168 (1189)
T KOG2041|consen 96 IVWMLYKGSWCEEMINNRNKSVVVSMSWNLDGTKICIVYEDGAVIVGSV-DGNRIWGKELKG------QLLAHVLWSEDL 168 (1189)
T ss_pred EEEeeecccHHHHHhhCcCccEEEEEEEcCCCcEEEEEEccCCEEEEee-ccceecchhcch------heccceeecccH
Confidence 99998877643322 3457899999999 555556776665543 2212211 1122 245678899999
Q ss_pred CEEEEEeCCCeEEEE
Q 040274 206 DVLGIGHSMGWSGIL 220 (359)
Q Consensus 206 ~~l~~g~~dg~~~i~ 220 (359)
..++.+-.+|-+.++
T Consensus 169 ~~~Lf~~ange~hly 183 (1189)
T KOG2041|consen 169 EQALFKKANGETHLY 183 (1189)
T ss_pred HHHHhhhcCCcEEEe
Confidence 888887777766654
No 278
>KOG1912 consensus WD40 repeat protein [General function prediction only]
Probab=98.52 E-value=2e-06 Score=82.46 Aligned_cols=143 Identities=16% Similarity=0.222 Sum_probs=108.8
Q ss_pred eeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecC------------CCEEEEecCCCeEEEEE
Q 040274 70 TDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPN------------GHLMATTGKECKIKIWD 137 (359)
Q Consensus 70 v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~------------g~~l~s~~~d~~i~vwd 137 (359)
-.++.|+|.| +|+.|+. ..|.+-|..+-+.+..+..|...|+.+.|.|- .-++|++...|.|.+||
T Consensus 18 ~~A~Dw~~~G-LiAygsh-slV~VVDs~s~q~iqsie~h~s~V~~VrWap~~~p~~llS~~~~~lliAsaD~~GrIil~d 95 (1062)
T KOG1912|consen 18 RNAADWSPSG-LIAYGSH-SLVSVVDSRSLQLIQSIELHQSAVTSVRWAPAPSPRDLLSPSSSQLLIASADISGRIILVD 95 (1062)
T ss_pred ccccccCccc-eEEEecC-ceEEEEehhhhhhhhccccCccceeEEEeccCCCchhccCccccceeEEeccccCcEEEEE
Confidence 4567888877 7888764 47889999999999999999999999999872 12577788889999999
Q ss_pred cCCCeeeEee---cCCceeEEEcCCC------cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccC-CCE
Q 040274 138 LRKYEVLQTL---TGHAKTLDFSQKG------LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPY-EDV 207 (359)
Q Consensus 138 ~~~~~~~~~~---~~~v~~~~~s~~g------l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-~~~ 207 (359)
...+..+..+ ..++..++|-+.- +++....++|.+|+..++......-..|. ...|+.+.|. .+.
T Consensus 96 ~~~~s~~~~l~~~~~~~qdl~W~~~rd~Srd~LlaIh~ss~lvLwntdtG~k~Wk~~ys~~-----iLs~f~~DPfd~rh 170 (1062)
T KOG1912|consen 96 FVLASVINWLSHSNDSVQDLCWVPARDDSRDVLLAIHGSSTLVLWNTDTGEKFWKYDYSHE-----ILSCFRVDPFDSRH 170 (1062)
T ss_pred ehhhhhhhhhcCCCcchhheeeeeccCcchheeEEecCCcEEEEEEccCCceeeccccCCc-----ceeeeeeCCCCcce
Confidence 9988776666 4567888886632 67777789999999777655444444442 5777999994 467
Q ss_pred EEEEeCCCeEEE
Q 040274 208 LGIGHSMGWSGI 219 (359)
Q Consensus 208 l~~g~~dg~~~i 219 (359)
+..-+..|++-+
T Consensus 171 ~~~l~s~g~vl~ 182 (1062)
T KOG1912|consen 171 FCVLGSKGFVLS 182 (1062)
T ss_pred EEEEccCceEEE
Confidence 777777776644
No 279
>PF04762 IKI3: IKI3 family; InterPro: IPR006849 Members of this family are components of the elongator multi-subunit component of a novel RNA polymerase II holoenzyme for transcriptional elongation [].
Probab=98.49 E-value=8.1e-06 Score=83.85 Aligned_cols=149 Identities=11% Similarity=0.120 Sum_probs=97.7
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCC---------------CCcce--------EEeec------------------
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPT---------------TSALL--------IKMLY------------------ 107 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~---------------~~~~~--------~~~~~------------------ 107 (359)
.|.|++||||+.+|+....+|+|.+.+-. ..+++ ..|.|
T Consensus 122 GI~a~~WSPD~Ella~vT~~~~l~~mt~~fd~i~E~~l~~~~~~~~~~VsVGWGkKeTQF~Gs~gK~aa~~~~~p~~~~~ 201 (928)
T PF04762_consen 122 GILAASWSPDEELLALVTGEGNLLLMTRDFDPISEVPLDSDDFGESKHVSVGWGKKETQFHGSAGKAAARQLRDPTVPKV 201 (928)
T ss_pred cEEEEEECCCcCEEEEEeCCCEEEEEeccceEEEEeecCccccCCCceeeeccCcccCccCcchhhhhhhhccCCCCCcc
Confidence 89999999999999999988888766421 00011 11111
Q ss_pred ------CCCCeEEEEEecCCCEEEEecC---C---CeEEEEEcCCCeeeEee---cCCceeEEEcCCC-cEEEEcC----
Q 040274 108 ------HQGPVSALAFHPNGHLMATTGK---E---CKIKIWDLRKYEVLQTL---TGHAKTLDFSQKG-LLAVGTG---- 167 (359)
Q Consensus 108 ------h~~~v~~l~~~p~g~~l~s~~~---d---~~i~vwd~~~~~~~~~~---~~~v~~~~~s~~g-l~~~~~d---- 167 (359)
+...-..++|-.||.|||+++. . ..|+||+-. |....+- .+--.+++|.|+| +++++..
T Consensus 202 d~~~~s~dd~~~~ISWRGDG~yFAVss~~~~~~~~R~iRVy~Re-G~L~stSE~v~gLe~~l~WrPsG~lIA~~q~~~~~ 280 (928)
T PF04762_consen 202 DEGKLSWDDGRVRISWRGDGEYFAVSSVEPETGSRRVIRVYSRE-GELQSTSEPVDGLEGALSWRPSGNLIASSQRLPDR 280 (928)
T ss_pred ccCccccCCCceEEEECCCCcEEEEEEEEcCCCceeEEEEECCC-ceEEeccccCCCccCCccCCCCCCEEEEEEEcCCC
Confidence 2223467889999999998775 2 579999965 6543333 2334689999999 7777653
Q ss_pred CcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 168 SFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 168 ~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
..|.+|. +++- ....+.-........|..+.|++|+.+||+...+. +.+|.
T Consensus 281 ~~VvFfE-rNGL-rhgeF~l~~~~~~~~v~~l~Wn~ds~iLAv~~~~~-vqLWt 331 (928)
T PF04762_consen 281 HDVVFFE-RNGL-RHGEFTLRFDPEEEKVIELAWNSDSEILAVWLEDR-VQLWT 331 (928)
T ss_pred cEEEEEe-cCCc-EeeeEecCCCCCCceeeEEEECCCCCEEEEEecCC-ceEEE
Confidence 4666776 5542 22222111111334799999999999999987666 66653
No 280
>KOG4532 consensus WD40-like repeat containing protein [General function prediction only]
Probab=98.47 E-value=8.4e-06 Score=69.14 Aligned_cols=111 Identities=14% Similarity=0.060 Sum_probs=85.2
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCC-cceEE--eecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCe-ee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTS-ALLIK--MLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYE-VL 144 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~-~~~~~--~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~-~~ 144 (359)
.++++++++++.++++.+....|..|.+... +.+.. ....++.-.+.+|+.....+|++..||++.|||+|... +.
T Consensus 160 ~~ns~~~snd~~~~~~Vgds~~Vf~y~id~~sey~~~~~~a~t~D~gF~~S~s~~~~~FAv~~Qdg~~~I~DVR~~~tpm 239 (344)
T KOG4532|consen 160 TQNSLHYSNDPSWGSSVGDSRRVFRYAIDDESEYIENIYEAPTSDHGFYNSFSENDLQFAVVFQDGTCAIYDVRNMATPM 239 (344)
T ss_pred ceeeeEEcCCCceEEEecCCCcceEEEeCCccceeeeeEecccCCCceeeeeccCcceEEEEecCCcEEEEEecccccch
Confidence 4889999999999999999999999998753 33332 22344556788999999999999999999999999743 33
Q ss_pred Eee-------cCCceeEEEcCCC---cEEEEc-CCcEEEEcCCCCC
Q 040274 145 QTL-------TGHAKTLDFSQKG---LLAVGT-GSFAQILGDFSGS 179 (359)
Q Consensus 145 ~~~-------~~~v~~~~~s~~g---l~~~~~-d~~i~v~d~~~~~ 179 (359)
... .|.+..+.|++-| |+..+. -+.+.|.|+++..
T Consensus 240 ~~~sstrp~hnGa~R~c~Fsl~g~lDLLf~sEhfs~~hv~D~R~~~ 285 (344)
T KOG4532|consen 240 AEISSTRPHHNGAFRVCRFSLYGLLDLLFISEHFSRVHVVDTRNYV 285 (344)
T ss_pred hhhcccCCCCCCceEEEEecCCCcceEEEEecCcceEEEEEcccCc
Confidence 332 3568999999977 555554 4789999987653
No 281
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=98.46 E-value=5.5e-05 Score=68.92 Aligned_cols=148 Identities=14% Similarity=0.151 Sum_probs=89.8
Q ss_pred EEEEcCCCCEEEEEe-C-CCeEEEEeCCCCcceEEeecCC------------------C-------------CeEEE---
Q 040274 72 LMRVNPFNGVVSLGH-S-GGTVTMWKPTTSALLIKMLYHQ------------------G-------------PVSAL--- 115 (359)
Q Consensus 72 ~l~~sp~~~~l~tg~-~-dg~v~lwd~~~~~~~~~~~~h~------------------~-------------~v~~l--- 115 (359)
.++++|||++|++.. . +..|.+.|+.+++.+..+.-.. + .+...
T Consensus 109 ~~~ls~dgk~l~V~n~~p~~~V~VvD~~~~kvv~ei~vp~~~~vy~t~e~~~~~~~~Dg~~~~v~~d~~g~~~~~~~~vf 188 (352)
T TIGR02658 109 MTSLTPDNKTLLFYQFSPSPAVGVVDLEGKAFVRMMDVPDCYHIFPTANDTFFMHCRDGSLAKVGYGTKGNPKIKPTEVF 188 (352)
T ss_pred eEEECCCCCEEEEecCCCCCEEEEEECCCCcEEEEEeCCCCcEEEEecCCccEEEeecCceEEEEecCCCceEEeeeeee
Confidence 678888888887765 3 6788888887765443322100 0 00010
Q ss_pred -----------EEec-CCCEEEEecCCCeEEEEEcCC-----CeeeEee----------cCCceeEEEcCCC--cEEEE-
Q 040274 116 -----------AFHP-NGHLMATTGKECKIKIWDLRK-----YEVLQTL----------TGHAKTLDFSQKG--LLAVG- 165 (359)
Q Consensus 116 -----------~~~p-~g~~l~s~~~d~~i~vwd~~~-----~~~~~~~----------~~~v~~~~~s~~g--l~~~~- 165 (359)
.|.+ +|.+++.+.. |+|++.|+.. ...+..+ ++.+.-++++|+| ++...
T Consensus 189 ~~~~~~v~~rP~~~~~dg~~~~vs~e-G~V~~id~~~~~~~~~~~~~~~~~~~~~~~wrP~g~q~ia~~~dg~~lyV~~~ 267 (352)
T TIGR02658 189 HPEDEYLINHPAYSNKSGRLVWPTYT-GKIFQIDLSSGDAKFLPAIEAFTEAEKADGWRPGGWQQVAYHRARDRIYLLAD 267 (352)
T ss_pred cCCccccccCCceEcCCCcEEEEecC-CeEEEEecCCCcceecceeeeccccccccccCCCcceeEEEcCCCCEEEEEec
Confidence 1233 6777766666 9999999643 2223222 1122349999998 33322
Q ss_pred ---------cCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCC-EEEEEe-CCCeEEEEEcCCCC
Q 040274 166 ---------TGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYED-VLGIGH-SMGWSGILVPRSSE 226 (359)
Q Consensus 166 ---------~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~-~l~~g~-~dg~~~i~~~gs~~ 226 (359)
..+.|.++|+.+. +....+..- ..+..++|+||++ +|++.. .++.+.++...++.
T Consensus 268 ~~~~~thk~~~~~V~ViD~~t~-kvi~~i~vG-----~~~~~iavS~Dgkp~lyvtn~~s~~VsViD~~t~k 333 (352)
T TIGR02658 268 QRAKWTHKTASRFLFVVDAKTG-KRLRKIELG-----HEIDSINVSQDAKPLLYALSTGDKTLYIFDAETGK 333 (352)
T ss_pred CCccccccCCCCEEEEEECCCC-eEEEEEeCC-----CceeeEEECCCCCeEEEEeCCCCCcEEEEECcCCe
Confidence 1258999996554 444433322 2689999999999 777666 46778887765554
No 282
>KOG2695 consensus WD40 repeat protein [General function prediction only]
Probab=98.46 E-value=4e-07 Score=79.50 Aligned_cols=151 Identities=15% Similarity=0.010 Sum_probs=105.8
Q ss_pred eEEEEcCCC-CEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCC-----eee
Q 040274 71 DLMRVNPFN-GVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKY-----EVL 144 (359)
Q Consensus 71 ~~l~~sp~~-~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~-----~~~ 144 (359)
+.++|+-+- .+-++.+.+..|-+-|+.|+. ...| ...+.|.++.|...++++..|+..|.|..+|+|.. .+.
T Consensus 215 ~~CawSlni~gyhfs~G~sqqv~L~nvetg~-~qsf-~sksDVfAlQf~~s~nLv~~GcRngeI~~iDLR~rnqG~~~~a 292 (425)
T KOG2695|consen 215 WSCAWSLNIMGYHFSVGLSQQVLLTNVETGH-QQSF-QSKSDVFALQFAGSDNLVFNGCRNGEIFVIDLRCRNQGNGWCA 292 (425)
T ss_pred hhhhhhhccceeeecccccceeEEEEeeccc-cccc-ccchhHHHHHhcccCCeeEecccCCcEEEEEeeecccCCCcce
Confidence 334665421 122444456677788888764 2333 35778999999998999999999999999999863 344
Q ss_pred Eee--cCCceeEEEcC-CC--cEEEEcCCcEEEEcCCCCC--ccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeE
Q 040274 145 QTL--TGHAKTLDFSQ-KG--LLAVGTGSFAQILGDFSGS--HNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWS 217 (359)
Q Consensus 145 ~~~--~~~v~~~~~s~-~g--l~~~~~d~~i~v~d~~~~~--~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~ 217 (359)
+.+ ...|+++..-. ++ +++.+.+|.|.+||.+... ..+..|.+|.. ...-.-+...+.+..+++++.|.+.
T Consensus 293 ~rlyh~Ssvtslq~Lq~s~q~LmaS~M~gkikLyD~R~~K~~~~V~qYeGHvN--~~a~l~~~v~~eeg~I~s~GdDcyt 370 (425)
T KOG2695|consen 293 QRLYHDSSVTSLQILQFSQQKLMASDMTGKIKLYDLRATKCKKSVMQYEGHVN--LSAYLPAHVKEEEGSIFSVGDDCYT 370 (425)
T ss_pred EEEEcCcchhhhhhhccccceEeeccCcCceeEeeehhhhcccceeeeecccc--cccccccccccccceEEEccCeeEE
Confidence 444 56677776555 33 8888999999999976542 23778888843 2223345566778889999999999
Q ss_pred EEEEcCCC
Q 040274 218 GILVPRSS 225 (359)
Q Consensus 218 ~i~~~gs~ 225 (359)
+||...++
T Consensus 371 RiWsl~~g 378 (425)
T KOG2695|consen 371 RIWSLDSG 378 (425)
T ss_pred EEEecccC
Confidence 99876543
No 283
>KOG1064 consensus RAVE (regulator of V-ATPase assembly) complex subunit RAV1/DMX protein, WD repeat superfamily [General function prediction only]
Probab=98.44 E-value=5.5e-07 Score=93.23 Aligned_cols=155 Identities=18% Similarity=0.253 Sum_probs=120.3
Q ss_pred eEEEECCCCCEEEEecc------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeec
Q 040274 52 ILWILPSSGRYMAVAGR------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLY 107 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~ 107 (359)
.++.-+|...+.++|+. .|+.+.|+.+|+.+..+..||.+.+|.+. .++....++
T Consensus 2212 ~r~~sHp~~~~Yltgs~dgsv~~~~w~~~~~v~~~rt~g~s~vtr~~f~~qGnk~~i~d~dg~l~l~q~~-pk~~~s~qc 2290 (2439)
T KOG1064|consen 2212 RRMTSHPSDPYYLTGSQDGSVRMFEWGHGQQVVCFRTAGNSRVTRSRFNHQGNKFGIVDGDGDLSLWQAS-PKPYTSWQC 2290 (2439)
T ss_pred eeecCCCCCceEEecCCCceEEEEeccCCCeEEEeeccCcchhhhhhhcccCCceeeeccCCceeecccC-Ccceecccc
Confidence 55555676666677665 78899999999999999999999999987 677778889
Q ss_pred CCCCeEEEEEecCCCEEEEecC---CCeEEEEEcCC---CeeeEee-cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCC
Q 040274 108 HQGPVSALAFHPNGHLMATTGK---ECKIKIWDLRK---YEVLQTL-TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSG 178 (359)
Q Consensus 108 h~~~v~~l~~~p~g~~l~s~~~---d~~i~vwd~~~---~~~~~~~-~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~ 178 (359)
|....+.+.|-. ..+++++. ++++.+||..- ..++++. .+.++++++-|.. +++||.+|.|++||++..
T Consensus 2291 hnk~~~Df~Fi~--s~~~tag~s~d~~n~~lwDtl~~~~~s~v~~~H~~gaT~l~~~P~~qllisggr~G~v~l~D~rqr 2368 (2439)
T KOG1064|consen 2291 HNKALSDFRFIG--SLLATAGRSSDNRNVCLWDTLLPPMNSLVHTCHDGGATVLAYAPKHQLLISGGRKGEVCLFDIRQR 2368 (2439)
T ss_pred CCccccceeeee--hhhhccccCCCCCcccchhcccCcccceeeeecCCCceEEEEcCcceEEEecCCcCcEEEeehHHH
Confidence 999999988865 56777653 68899999753 2345554 5678999999998 889999999999996433
Q ss_pred CccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCC
Q 040274 179 SHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRS 224 (359)
Q Consensus 179 ~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs 224 (359)
.. .|.. +. +. ...++++|+..|.+.||-...
T Consensus 2369 -ql-----~h~~----~~----~~-~~~~f~~~ss~g~ikIw~~s~ 2399 (2439)
T KOG1064|consen 2369 -QL-----RHTF----QA----LD-TREYFVTGSSEGNIKIWRLSE 2399 (2439)
T ss_pred -HH-----HHHh----hh----hh-hhheeeccCcccceEEEEccc
Confidence 11 2211 22 44 678999999999999997653
No 284
>KOG2066 consensus Vacuolar assembly/sorting protein VPS41 [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.39 E-value=2.9e-06 Score=81.81 Aligned_cols=132 Identities=11% Similarity=0.099 Sum_probs=95.5
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEe--
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQT-- 146 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~-- 146 (359)
.++|++++ +.+|+.|..+|.|++++.. +.+ .+...|... +-+|.+++||+.||+|.|-.+-+.+..++
T Consensus 41 ~is~~av~--~~~~~~GtH~g~v~~~~~~-~~~-~~~~~~s~~------~~~Gey~asCS~DGkv~I~sl~~~~~~~~~d 110 (846)
T KOG2066|consen 41 AISCCAVH--DKFFALGTHRGAVYLTTCQ-GNP-KTNFDHSSS------ILEGEYVASCSDDGKVVIGSLFTDDEITQYD 110 (846)
T ss_pred HHHHHHhh--cceeeeccccceEEEEecC-Ccc-ccccccccc------ccCCceEEEecCCCcEEEeeccCCccceeEe
Confidence 46666665 5689999999999999876 333 444455543 66899999999999999999888766554
Q ss_pred ecCCceeEEEcCCC-------cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCe
Q 040274 147 LTGHAKTLDFSQKG-------LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGW 216 (359)
Q Consensus 147 ~~~~v~~~~~s~~g-------l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~ 216 (359)
|..++.+++++|+- +++||..| +.++.-..-+. ......+. ..++|.++.| .|+++|-++.+|+
T Consensus 111 f~rpiksial~Pd~~~~~sk~fv~GG~ag-lvL~er~wlgn-k~~v~l~~--~eG~I~~i~W--~g~lIAWand~Gv 181 (846)
T KOG2066|consen 111 FKRPIKSIALHPDFSRQQSKQFVSGGMAG-LVLSERNWLGN-KDSVVLSE--GEGPIHSIKW--RGNLIAWANDDGV 181 (846)
T ss_pred cCCcceeEEeccchhhhhhhheeecCcce-EEEehhhhhcC-ccceeeec--CccceEEEEe--cCcEEEEecCCCc
Confidence 47789999999982 77888777 87776221111 11222332 2347999999 6789999999885
No 285
>COG5170 CDC55 Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=98.39 E-value=4.7e-06 Score=72.06 Aligned_cols=161 Identities=9% Similarity=0.119 Sum_probs=106.2
Q ss_pred eEEEECCCCCEEEEecc----------------------------------------ceeEEEEcCCC--CEEEEEeCCC
Q 040274 52 ILWILPSSGRYMAVAGR----------------------------------------RTDLMRVNPFN--GVVSLGHSGG 89 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~----------------------------------------~v~~l~~sp~~--~~l~tg~~dg 89 (359)
.++.|...|.||++|.. .|+.+.|-.++ ..++..+.|.
T Consensus 30 taVefd~tg~YlatGDkgGRVvlfer~~s~~ceykf~teFQshe~EFDYLkSleieEKin~I~w~~~t~r~hFLlstNdk 109 (460)
T COG5170 30 TAVEFDETGLYLATGDKGGRVVLFEREKSYGCEYKFFTEFQSHELEFDYLKSLEIEEKINAIEWFDDTGRNHFLLSTNDK 109 (460)
T ss_pred eEEEeccccceEeecCCCceEEEeecccccccchhhhhhhcccccchhhhhhccHHHHhhheeeecCCCcceEEEecCCc
Confidence 78888899999999864 68889986644 3567777899
Q ss_pred eEEEEeCCCC-------------------cc-----------------------eEEe-ecCCCCeEEEEEecCCCEEEE
Q 040274 90 TVTMWKPTTS-------------------AL-----------------------LIKM-LYHQGPVSALAFHPNGHLMAT 126 (359)
Q Consensus 90 ~v~lwd~~~~-------------------~~-----------------------~~~~-~~h~~~v~~l~~~p~g~~l~s 126 (359)
+|.+|.+... .+ ...+ ..|.-.+++++|+.|...+++
T Consensus 110 tiKlWKiyeknlk~va~nnls~~~~~~~~g~~~s~~~l~lprls~hd~iiaa~p~rvyaNaH~yhiNSiS~NsD~et~lS 189 (460)
T COG5170 110 TIKLWKIYEKNLKVVAENNLSDSFHSPMGGPLTSTKELLLPRLSEHDEIIAAKPCRVYANAHPYHINSISFNSDKETLLS 189 (460)
T ss_pred eeeeeeeecccchhhhccccccccccccCCCcCCHHHhhcccccccceEEEeccceeccccceeEeeeeeecCchheeee
Confidence 9999986422 00 0011 256667889999998887777
Q ss_pred ecCCCeEEEEEcCCCeeeEee---c--------CCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCc-----ccc-ccc
Q 040274 127 TGKECKIKIWDLRKYEVLQTL---T--------GHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSH-----NYS-RYM 186 (359)
Q Consensus 127 ~~~d~~i~vwd~~~~~~~~~~---~--------~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~-----~~~-~~~ 186 (359)
+ .|=.|.+|++........+ . .-|++..|+|.. +...++.|.|.+-|++...- ... .+.
T Consensus 190 a-DdLrINLWnl~i~D~sFnIVDiKP~nmeeLteVItSaeFhp~~cn~fmYSsSkG~Ikl~DlRq~alcdn~~klfe~~~ 268 (460)
T COG5170 190 A-DDLRINLWNLEIIDGSFNIVDIKPHNMEELTEVITSAEFHPEMCNVFMYSSSKGEIKLNDLRQSALCDNSKKLFELTI 268 (460)
T ss_pred c-cceeeeeccccccCCceEEEeccCccHHHHHHHHhhcccCHhHcceEEEecCCCcEEehhhhhhhhccCchhhhhhcc
Confidence 5 5677999988643222222 1 126888999976 55666789999999874311 110 000
Q ss_pred ---cccC--CCCcceeEEEEccCCCEEEEEeC
Q 040274 187 ---GNSM--VKGYQIGKVSFRPYEDVLGIGHS 213 (359)
Q Consensus 187 ---~~~~--~~~~~v~~~~~sp~~~~l~~g~~ 213 (359)
.+.. .....|..+.|++.|+++++-..
T Consensus 269 D~v~~~ff~eivsSISD~kFs~ngryIlsRdy 300 (460)
T COG5170 269 DGVDVDFFEEIVSSISDFKFSDNGRYILSRDY 300 (460)
T ss_pred CcccchhHHHHhhhhcceEEcCCCcEEEEecc
Confidence 0000 01235888999999999887543
No 286
>COG4946 Uncharacterized protein related to the periplasmic component of the Tol biopolymer transport system [Function unknown]
Probab=98.34 E-value=4.3e-05 Score=69.78 Aligned_cols=135 Identities=13% Similarity=0.096 Sum_probs=98.9
Q ss_pred EcC-CCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCC-eEEEEEcCCCeeeEee--cCC
Q 040274 75 VNP-FNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKEC-KIKIWDLRKYEVLQTL--TGH 150 (359)
Q Consensus 75 ~sp-~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~-~i~vwd~~~~~~~~~~--~~~ 150 (359)
|++ +|.++++.|. |.+.|.+...+-.+. .+|.+.|.-..+..++.-++.|..|| .+-|||.++++..... -+.
T Consensus 327 fa~~~Gd~ia~VSR-GkaFi~~~~~~~~iq--v~~~~~VrY~r~~~~~e~~vigt~dgD~l~iyd~~~~e~kr~e~~lg~ 403 (668)
T COG4946 327 FAVVNGDYIALVSR-GKAFIMRPWDGYSIQ--VGKKGGVRYRRIQVDPEGDVIGTNDGDKLGIYDKDGGEVKRIEKDLGN 403 (668)
T ss_pred hccCCCcEEEEEec-CcEEEECCCCCeeEE--cCCCCceEEEEEccCCcceEEeccCCceEEEEecCCceEEEeeCCccc
Confidence 455 5777777764 677777766554333 26778888888888888899999999 8999999988754444 467
Q ss_pred ceeEEEcCCC-cEEEEcC-CcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeE
Q 040274 151 AKTLDFSQKG-LLAVGTG-SFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWS 217 (359)
Q Consensus 151 v~~~~~s~~g-l~~~~~d-~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~ 217 (359)
|.++..+|+| .++++.+ ..|.++|+.++ .....-... -..|+.+.|||+++++|-+--+|++
T Consensus 404 I~av~vs~dGK~~vvaNdr~el~vididng-nv~~idkS~----~~lItdf~~~~nsr~iAYafP~gy~ 467 (668)
T COG4946 404 IEAVKVSPDGKKVVVANDRFELWVIDIDNG-NVRLIDKSE----YGLITDFDWHPNSRWIAYAFPEGYY 467 (668)
T ss_pred eEEEEEcCCCcEEEEEcCceEEEEEEecCC-CeeEecccc----cceeEEEEEcCCceeEEEecCccee
Confidence 8999999999 5555554 67888887665 222222222 2369999999999999999888864
No 287
>COG5354 Uncharacterized protein, contains Trp-Asp (WD) repeat [General function prediction only]
Probab=98.33 E-value=1.7e-05 Score=72.88 Aligned_cols=148 Identities=13% Similarity=0.249 Sum_probs=104.5
Q ss_pred eEEEECCCCCEEEEecc---------------------------------ceeEEEEcCCCCEEEEEe--CCCeEEEEeC
Q 040274 52 ILWILPSSGRYMAVAGR---------------------------------RTDLMRVNPFNGVVSLGH--SGGTVTMWKP 96 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~---------------------------------~v~~l~~sp~~~~l~tg~--~dg~v~lwd~ 96 (359)
..|.|++.|.+|+.--. +|+..+|+|.+..+++.+ .+-++.++|+
T Consensus 226 ~qLkW~~~g~~ll~l~~t~~ksnKsyfgesnLyl~~~~e~~i~V~~~~~~pVhdf~W~p~S~~F~vi~g~~pa~~s~~~l 305 (561)
T COG5354 226 VQLKWQVLGKYLLVLVMTHTKSNKSYFGESNLYLLRITERSIPVEKDLKDPVHDFTWEPLSSRFAVISGYMPASVSVFDL 305 (561)
T ss_pred cEEEEecCCceEEEEEEEeeecccceeccceEEEEeecccccceeccccccceeeeecccCCceeEEecccccceeeccc
Confidence 78888899988765322 899999999887665544 6778999998
Q ss_pred CCCcceEEeecCCCCeEEEEEecCCCEEEEecCC---CeEEEEEcCCCe-eeEeecCC-ceeEEEcCCC-cEEEE-----
Q 040274 97 TTSALLIKMLYHQGPVSALAFHPNGHLMATTGKE---CKIKIWDLRKYE-VLQTLTGH-AKTLDFSQKG-LLAVG----- 165 (359)
Q Consensus 97 ~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d---~~i~vwd~~~~~-~~~~~~~~-v~~~~~s~~g-l~~~~----- 165 (359)
+.. + .+......=+.+.|+|.+++++.++-| |.|-+||....- ++..+.+. .+-+.|+|+| ++-.+
T Consensus 306 r~N--l-~~~~Pe~~rNT~~fsp~~r~il~agF~nl~gni~i~~~~~rf~~~~~~~~~n~s~~~wspd~qF~~~~~ts~k 382 (561)
T COG5354 306 RGN--L-RFYFPEQKRNTIFFSPHERYILFAGFDNLQGNIEIFDPAGRFKVAGAFNGLNTSYCDWSPDGQFYDTDTTSEK 382 (561)
T ss_pred ccc--e-EEecCCcccccccccCcccEEEEecCCccccceEEeccCCceEEEEEeecCCceEeeccCCceEEEecCCCcc
Confidence 865 2 333445556778999999999998765 789999987643 44456544 4667899999 43333
Q ss_pred --cCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 166 --TGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 166 --~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
.|+.|.|||+... ... ..+.+.|.|.|++..+.+..+
T Consensus 383 ~~~Dn~i~l~~v~g~-~~f------------el~~~~W~p~~~~~ttsSs~~ 421 (561)
T COG5354 383 LRVDNSIKLWDVYGA-KVF------------ELTNITWDPSGQYVTTSSSCP 421 (561)
T ss_pred cccCcceEEEEecCc-hhh------------hhhhccccCCcccceeeccCC
Confidence 2678999995332 110 356678888888777666554
No 288
>PF08450 SGL: SMP-30/Gluconolaconase/LRE-like region; InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=98.33 E-value=0.00026 Score=61.98 Aligned_cols=151 Identities=14% Similarity=0.103 Sum_probs=94.5
Q ss_pred ceeEEEEc-CCCCEEEEEeCCCeEEEEeCCCCcceEEeec-----CCCCeEEEEEecCCCEEEEecCC--------CeEE
Q 040274 69 RTDLMRVN-PFNGVVSLGHSGGTVTMWKPTTSALLIKMLY-----HQGPVSALAFHPNGHLMATTGKE--------CKIK 134 (359)
Q Consensus 69 ~v~~l~~s-p~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~-----h~~~v~~l~~~p~g~~l~s~~~d--------~~i~ 134 (359)
....+++. +++ .|+.+..+ .+.++|+.+++....+.. .....+.++++|+|++.++.... |.|+
T Consensus 41 ~~~G~~~~~~~g-~l~v~~~~-~~~~~d~~~g~~~~~~~~~~~~~~~~~~ND~~vd~~G~ly~t~~~~~~~~~~~~g~v~ 118 (246)
T PF08450_consen 41 GPNGMAFDRPDG-RLYVADSG-GIAVVDPDTGKVTVLADLPDGGVPFNRPNDVAVDPDGNLYVTDSGGGGASGIDPGSVY 118 (246)
T ss_dssp SEEEEEEECTTS-EEEEEETT-CEEEEETTTTEEEEEEEEETTCSCTEEEEEEEE-TTS-EEEEEECCBCTTCGGSEEEE
T ss_pred CCceEEEEccCC-EEEEEEcC-ceEEEecCCCcEEEEeeccCCCcccCCCceEEEcCCCCEEEEecCCCccccccccceE
Confidence 46777887 565 45555544 455669988854433332 34567899999999987776543 5688
Q ss_pred EEEcCCCeeeEee--cCCceeEEEcCCC--c-EEEEcCCcEEEEcCCCCCccc---cccccccCCCCcceeEEEEccCCC
Q 040274 135 IWDLRKYEVLQTL--TGHAKTLDFSQKG--L-LAVGTGSFAQILGDFSGSHNY---SRYMGNSMVKGYQIGKVSFRPYED 206 (359)
Q Consensus 135 vwd~~~~~~~~~~--~~~v~~~~~s~~g--l-~~~~~d~~i~v~d~~~~~~~~---~~~~~~~~~~~~~v~~~~~sp~~~ 206 (359)
.++.. ++..... -...+.++|+|++ + ++-+..+.|..|++....... ..+..... .....-.+++..+|+
T Consensus 119 ~~~~~-~~~~~~~~~~~~pNGi~~s~dg~~lyv~ds~~~~i~~~~~~~~~~~~~~~~~~~~~~~-~~g~pDG~~vD~~G~ 196 (246)
T PF08450_consen 119 RIDPD-GKVTVVADGLGFPNGIAFSPDGKTLYVADSFNGRIWRFDLDADGGELSNRRVFIDFPG-GPGYPDGLAVDSDGN 196 (246)
T ss_dssp EEETT-SEEEEEEEEESSEEEEEEETTSSEEEEEETTTTEEEEEEEETTTCCEEEEEEEEE-SS-SSCEEEEEEEBTTS-
T ss_pred EECCC-CeEEEEecCcccccceEECCcchheeecccccceeEEEeccccccceeeeeeEEEcCC-CCcCCCcceEcCCCC
Confidence 88877 5543333 3446899999999 3 344556888888864332211 12222111 111367899999999
Q ss_pred EEEEEeCCCeEEEEEcC
Q 040274 207 VLGIGHSMGWSGILVPR 223 (359)
Q Consensus 207 ~l~~g~~dg~~~i~~~g 223 (359)
+.++....+.+.++.+.
T Consensus 197 l~va~~~~~~I~~~~p~ 213 (246)
T PF08450_consen 197 LWVADWGGGRIVVFDPD 213 (246)
T ss_dssp EEEEEETTTEEEEEETT
T ss_pred EEEEEcCCCEEEEECCC
Confidence 88888888888888765
No 289
>PF11768 DUF3312: Protein of unknown function (DUF3312); InterPro: IPR024511 This is a eukaryotic family of uncharacterised proteins that contain WD40 repeats.
Probab=98.33 E-value=1.7e-05 Score=74.47 Aligned_cols=110 Identities=9% Similarity=0.013 Sum_probs=76.9
Q ss_pred ceeEEEEcC-CCCEEEEE----eCCCe----EEEEeCCCCcc--eE-EeecCCCCeEEEEEecCCCEEEEecCCCeEEEE
Q 040274 69 RTDLMRVNP-FNGVVSLG----HSGGT----VTMWKPTTSAL--LI-KMLYHQGPVSALAFHPNGHLMATTGKECKIKIW 136 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg----~~dg~----v~lwd~~~~~~--~~-~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vw 136 (359)
...++.||- +...+.|. +.+|. -++|++...+. +. +-......|.+++++|+...|+.|+.||+|.+|
T Consensus 207 dPl~~~Fs~~~~~qi~tVE~s~s~~g~~~~d~ciYE~~r~klqrvsvtsipL~s~v~~ca~sp~E~kLvlGC~DgSiiLy 286 (545)
T PF11768_consen 207 DPLDVEFSLNQPYQIHTVEQSISVKGEPSADSCIYECSRNKLQRVSVTSIPLPSQVICCARSPSEDKLVLGCEDGSIILY 286 (545)
T ss_pred CcEEEEccCCCCcEEEEEEEecCCCCCceeEEEEEEeecCceeEEEEEEEecCCcceEEecCcccceEEEEecCCeEEEE
Confidence 456777776 44455553 23443 34666654432 11 112567889999999999999999999999999
Q ss_pred EcCCCeeeEee-cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCC
Q 040274 137 DLRKYEVLQTL-TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSG 178 (359)
Q Consensus 137 d~~~~~~~~~~-~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~ 178 (359)
|...+.....- .-.++.++|+|+| +++++..|.+.+||+.-+
T Consensus 287 D~~~~~t~~~ka~~~P~~iaWHp~gai~~V~s~qGelQ~FD~ALs 331 (545)
T PF11768_consen 287 DTTRGVTLLAKAEFIPTLIAWHPDGAIFVVGSEQGELQCFDMALS 331 (545)
T ss_pred EcCCCeeeeeeecccceEEEEcCCCcEEEEEcCCceEEEEEeecC
Confidence 99876443332 3346899999999 555666699999997543
No 290
>PLN02919 haloacid dehalogenase-like hydrolase family protein
Probab=98.31 E-value=3.2e-05 Score=80.99 Aligned_cols=108 Identities=15% Similarity=0.107 Sum_probs=77.1
Q ss_pred eEEEEcCCCCEE-EEEeCCCeEEEEeCCCCcceEEeec-------------C--------CCCeEEEEEecCCCEEEEec
Q 040274 71 DLMRVNPFNGVV-SLGHSGGTVTMWKPTTSALLIKMLY-------------H--------QGPVSALAFHPNGHLMATTG 128 (359)
Q Consensus 71 ~~l~~sp~~~~l-~tg~~dg~v~lwd~~~~~~~~~~~~-------------h--------~~~v~~l~~~p~g~~l~s~~ 128 (359)
+.|+++|++..| ++-+.++.|++||+.++.......+ + -..-.+++|+++|.++++-+
T Consensus 743 ~GIavspdG~~LYVADs~n~~Irv~D~~tg~~~~~~gg~~~~~~~l~~fG~~dG~g~~~~l~~P~Gvavd~dG~LYVADs 822 (1057)
T PLN02919 743 SGISLSPDLKELYIADSESSSIRALDLKTGGSRLLAGGDPTFSDNLFKFGDHDGVGSEVLLQHPLGVLCAKDGQIYVADS 822 (1057)
T ss_pred cEEEEeCCCCEEEEEECCCCeEEEEECCCCcEEEEEecccccCcccccccCCCCchhhhhccCCceeeEeCCCcEEEEEC
Confidence 458999998854 4555678999999987643211100 0 01235889999999988888
Q ss_pred CCCeEEEEEcCCCeeeEee-c---------------CCceeEEEcCCC--cEEEEcCCcEEEEcCCCC
Q 040274 129 KECKIKIWDLRKYEVLQTL-T---------------GHAKTLDFSQKG--LLAVGTGSFAQILGDFSG 178 (359)
Q Consensus 129 ~d~~i~vwd~~~~~~~~~~-~---------------~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~ 178 (359)
.++.|++||..++...... . ..+..++++++| +++-+.++.|++||+.+.
T Consensus 823 ~N~rIrviD~~tg~v~tiaG~G~~G~~dG~~~~a~l~~P~GIavd~dG~lyVaDt~Nn~Irvid~~~~ 890 (1057)
T PLN02919 823 YNHKIKKLDPATKRVTTLAGTGKAGFKDGKALKAQLSEPAGLALGENGRLFVADTNNSLIRYLDLNKG 890 (1057)
T ss_pred CCCEEEEEECCCCeEEEEeccCCcCCCCCcccccccCCceEEEEeCCCCEEEEECCCCEEEEEECCCC
Confidence 9999999999877654322 1 135789999999 566667789999997554
No 291
>PF08450 SGL: SMP-30/Gluconolaconase/LRE-like region; InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=98.30 E-value=0.00019 Score=62.72 Aligned_cols=136 Identities=19% Similarity=0.227 Sum_probs=88.6
Q ss_pred ceeEEEEcCCCCEEEEEeCC--------CeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEE-EecCCCeEEEEEcC
Q 040274 69 RTDLMRVNPFNGVVSLGHSG--------GTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMA-TTGKECKIKIWDLR 139 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~d--------g~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~-s~~~d~~i~vwd~~ 139 (359)
..+.++++|+|.+.++.... |.|..++.. ++... +...-...+.++|+|+++.|+ +-+..+.|..||+.
T Consensus 87 ~~ND~~vd~~G~ly~t~~~~~~~~~~~~g~v~~~~~~-~~~~~-~~~~~~~pNGi~~s~dg~~lyv~ds~~~~i~~~~~~ 164 (246)
T PF08450_consen 87 RPNDVAVDPDGNLYVTDSGGGGASGIDPGSVYRIDPD-GKVTV-VADGLGFPNGIAFSPDGKTLYVADSFNGRIWRFDLD 164 (246)
T ss_dssp EEEEEEE-TTS-EEEEEECCBCTTCGGSEEEEEEETT-SEEEE-EEEEESSEEEEEEETTSSEEEEEETTTTEEEEEEEE
T ss_pred CCceEEEcCCCCEEEEecCCCccccccccceEEECCC-CeEEE-EecCcccccceEECCcchheeecccccceeEEEecc
Confidence 67889999999877776543 568888877 54333 333355678999999998765 56678889999986
Q ss_pred CC-e------eeEeecC---CceeEEEcCCC-cE-EEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEc-cCCC
Q 040274 140 KY-E------VLQTLTG---HAKTLDFSQKG-LL-AVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFR-PYED 206 (359)
Q Consensus 140 ~~-~------~~~~~~~---~v~~~~~s~~g-l~-~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~s-p~~~ 206 (359)
.. . .+..+.. ..-.+++..+| ++ +....+.|.++|.. + .....+.... ..+++++|. |+.+
T Consensus 165 ~~~~~~~~~~~~~~~~~~~g~pDG~~vD~~G~l~va~~~~~~I~~~~p~-G-~~~~~i~~p~----~~~t~~~fgg~~~~ 238 (246)
T PF08450_consen 165 ADGGELSNRRVFIDFPGGPGYPDGLAVDSDGNLWVADWGGGRIVVFDPD-G-KLLREIELPV----PRPTNCAFGGPDGK 238 (246)
T ss_dssp TTTCCEEEEEEEEE-SSSSCEEEEEEEBTTS-EEEEEETTTEEEEEETT-S-CEEEEEE-SS----SSEEEEEEESTTSS
T ss_pred ccccceeeeeeEEEcCCCCcCCCcceEcCCCCEEEEEcCCCEEEEECCC-c-cEEEEEcCCC----CCEEEEEEECCCCC
Confidence 32 1 1222222 26789999999 44 44457899999943 3 4444443331 268999994 6767
Q ss_pred EEEEEe
Q 040274 207 VLGIGH 212 (359)
Q Consensus 207 ~l~~g~ 212 (359)
.|++.+
T Consensus 239 ~L~vTt 244 (246)
T PF08450_consen 239 TLYVTT 244 (246)
T ss_dssp EEEEEE
T ss_pred EEEEEe
Confidence 665543
No 292
>PF11768 DUF3312: Protein of unknown function (DUF3312); InterPro: IPR024511 This is a eukaryotic family of uncharacterised proteins that contain WD40 repeats.
Probab=98.29 E-value=5.9e-06 Score=77.50 Aligned_cols=71 Identities=14% Similarity=0.296 Sum_probs=61.2
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCC
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKY 141 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~ 141 (359)
.|.|++++|+...++.|+.||+|.+||...+.. .+..+.-..+.++|+|+|..+++|+..|.+.+||+.-.
T Consensus 261 ~v~~ca~sp~E~kLvlGC~DgSiiLyD~~~~~t--~~~ka~~~P~~iaWHp~gai~~V~s~qGelQ~FD~ALs 331 (545)
T PF11768_consen 261 QVICCARSPSEDKLVLGCEDGSIILYDTTRGVT--LLAKAEFIPTLIAWHPDGAIFVVGSEQGELQCFDMALS 331 (545)
T ss_pred cceEEecCcccceEEEEecCCeEEEEEcCCCee--eeeeecccceEEEEcCCCcEEEEEcCCceEEEEEeecC
Confidence 799999999999999999999999999887633 23334556789999999999999999999999998643
No 293
>PF04053 Coatomer_WDAD: Coatomer WD associated region ; InterPro: IPR006692 Proteins synthesised on the ribosome and processed in the endoplasmic reticulum are transported from the Golgi apparatus to the trans-Golgi network (TGN), and from there via small carrier vesicles to their final destination compartment. This traffic is bidirectional, to ensure that proteins required to form vesicles are recycled. Vesicles have specific coat proteins (such as clathrin or coatomer) that are important for cargo selection and direction of transfer []. While clathrin mediates endocytic protein transport, and transport from ER to Golgi, coatomers primarily mediate intra-Golgi transport, as well as the reverse Golgi to ER transport of dilysine-tagged proteins []. For example, the coatomer COP1 (coat protein complex 1) is responsible for reverse transport of recycled proteins from Golgi and pre-Golgi compartments back to the ER, while COPII buds vesicles from the ER to the Golgi []. Coatomers reversibly associate with Golgi (non-clathrin-coated) vesicles to mediate protein transport and for budding from Golgi membranes []. Activated small guanine triphosphatases (GTPases) attract coat proteins to specific membrane export sites, thereby linking coatomers to export cargos. As coat proteins polymerise, vesicles are formed and budded from membrane-bound organelles. Coatomer complexes also influence Golgi structural integrity, as well as the processing, activity, and endocytic recycling of LDL receptors. In mammals, coatomer complexes can only be recruited by membranes associated to ADP-ribosylation factors (ARFs), which are small GTP-binding proteins. Coatomer complexes are hetero-oligomers composed of at least an alpha, beta, beta', gamma, delta, epsilon and zeta subunits. This entry represents the WD-associated region found in coatomer subunits alpha, beta and beta' subunits. The alpha-subunit (RET1P) of the coatomer complex in Saccharomyces cerevisiae (Baker's yeast), participates in membrane transport between the endoplasmic reticulum and Golgi apparatus. The protein contains six WD-40 repeat motifs in its N-terminal region []. More information about these proteins can be found at Protein of the Month: Clathrin [].; GO: 0005198 structural molecule activity, 0006886 intracellular protein transport, 0016192 vesicle-mediated transport, 0030117 membrane coat; PDB: 3MKQ_B.
Probab=98.28 E-value=4e-05 Score=72.32 Aligned_cols=167 Identities=15% Similarity=0.102 Sum_probs=91.3
Q ss_pred eEEEECCCCCEEEEecc-----------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEE
Q 040274 52 ILWILPSSGRYMAVAGR-----------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSA 114 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~ 114 (359)
..+.++|+|++++.++. .....+|.+.+ .+|+-..+++|.|+.--.......+.. ...+..
T Consensus 36 ~~ls~npngr~v~V~g~geY~iyt~~~~r~k~~G~g~~~vw~~~n-~yAv~~~~~~I~I~kn~~~~~~k~i~~-~~~~~~ 113 (443)
T PF04053_consen 36 QSLSHNPNGRFVLVCGDGEYEIYTALAWRNKAFGSGLSFVWSSRN-RYAVLESSSTIKIYKNFKNEVVKSIKL-PFSVEK 113 (443)
T ss_dssp SEEEE-TTSSEEEEEETTEEEEEETTTTEEEEEEE-SEEEE-TSS-EEEEE-TTS-EEEEETTEE-TT------SS-EEE
T ss_pred eeEEECCCCCEEEEEcCCEEEEEEccCCcccccCceeEEEEecCc-cEEEEECCCeEEEEEcCccccceEEcC-Ccccce
Confidence 88999999999999877 66778898844 566666688899963222232223322 122333
Q ss_pred EEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecCC-ceeEEEcCCC-cEEEEcCCcEEEEcCCCCC-----------cc
Q 040274 115 LAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTGH-AKTLDFSQKG-LLAVGTGSFAQILGDFSGS-----------HN 181 (359)
Q Consensus 115 l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~~-v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~-----------~~ 181 (359)
+-. |.+|+..+.+ .|.+||..+++.+..+.-. |..+.||++| +++...+..+.|++. ... ..
T Consensus 114 If~---G~LL~~~~~~-~i~~yDw~~~~~i~~i~v~~vk~V~Ws~~g~~val~t~~~i~il~~-~~~~~~~~~~~g~e~~ 188 (443)
T PF04053_consen 114 IFG---GNLLGVKSSD-FICFYDWETGKLIRRIDVSAVKYVIWSDDGELVALVTKDSIYILKY-NLEAVAAIPEEGVEDA 188 (443)
T ss_dssp EE----SSSEEEEETT-EEEEE-TTT--EEEEESS-E-EEEEE-TTSSEEEEE-S-SEEEEEE--HHHHHHBTTTB-GGG
T ss_pred EEc---CcEEEEECCC-CEEEEEhhHcceeeEEecCCCcEEEEECCCCEEEEEeCCeEEEEEe-cchhcccccccCchhc
Confidence 332 7777776655 8999999999999999654 7999999999 777777888888862 211 02
Q ss_pred ccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCCCceeeec
Q 040274 182 YSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSEPNFDSWV 233 (359)
Q Consensus 182 ~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~~~~~~~~ 233 (359)
...+... ...|.+..|..+ .++-.+.. .+..++ ++.-+.+...+
T Consensus 189 f~~~~E~----~~~IkSg~W~~d--~fiYtT~~-~lkYl~-~Ge~~~i~~ld 232 (443)
T PF04053_consen 189 FELIHEI----SERIKSGCWVED--CFIYTTSN-HLKYLV-NGETGIIAHLD 232 (443)
T ss_dssp EEEEEEE-----S--SEEEEETT--EEEEE-TT-EEEEEE-TTEEEEEEE-S
T ss_pred eEEEEEe----cceeEEEEEEcC--EEEEEcCC-eEEEEE-cCCcceEEEcC
Confidence 2222221 226888999766 44444444 444433 33333444433
No 294
>KOG0309 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=98.28 E-value=6.7e-06 Score=78.64 Aligned_cols=135 Identities=15% Similarity=0.269 Sum_probs=95.0
Q ss_pred ceeEEEEcCCC-CEEEEEeCCCeEEEEeCCCC-cceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCC-eeeE
Q 040274 69 RTDLMRVNPFN-GVVSLGHSGGTVTMWKPTTS-ALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKY-EVLQ 145 (359)
Q Consensus 69 ~v~~l~~sp~~-~~l~tg~~dg~v~lwd~~~~-~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~-~~~~ 145 (359)
.|+.+.|+|++ ..+++++.|-.|..||+++. .++..+..-......+.|+.-...+.+.+....|.+||.+.| .++.
T Consensus 116 aitd~n~~~q~pdVlatcsvdt~vh~wd~rSp~~p~ys~~~w~s~asqVkwnyk~p~vlasshg~~i~vwd~r~gs~pl~ 195 (1081)
T KOG0309|consen 116 AITDINFNPQHPDVLATCSVDTYVHAWDMRSPHRPFYSTSSWRSAASQVKWNYKDPNVLASSHGNDIFVWDLRKGSTPLC 195 (1081)
T ss_pred ceeccccCCCCCcceeeccccccceeeeccCCCcceeeeecccccCceeeecccCcchhhhccCCceEEEeccCCCcceE
Confidence 89999999965 57899999999999999875 456666655555678899874444555567778999999986 4677
Q ss_pred eecCCc---eeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCE
Q 040274 146 TLTGHA---KTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDV 207 (359)
Q Consensus 146 ~~~~~v---~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~ 207 (359)
++.+++ +.++|..-- +++++.|++|..||-....... .+......+|+.-+|.|.|.-
T Consensus 196 s~K~~vs~vn~~~fnr~~~s~~~s~~~d~tvkfw~y~kSt~e~----~~~vtt~~piw~~r~~Pfg~g 259 (1081)
T KOG0309|consen 196 SLKGHVSSVNSIDFNRFKYSEIMSSSNDGTVKFWDYSKSTTES----KRTVTTNFPIWRGRYLPFGEG 259 (1081)
T ss_pred EecccceeeehHHHhhhhhhhhcccCCCCceeeeccccccccc----ceeccccCcceeccccccCce
Confidence 887765 555665533 8899999999999954332111 111112336777777776543
No 295
>KOG1832 consensus HIV-1 Vpr-binding protein [Cell cycle control, cell division, chromosome partitioning]
Probab=98.27 E-value=1.2e-06 Score=85.25 Aligned_cols=139 Identities=12% Similarity=0.185 Sum_probs=105.1
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCC--eEEEEEcCC-CeeeE
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKEC--KIKIWDLRK-YEVLQ 145 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~--~i~vwd~~~-~~~~~ 145 (359)
..+|++|+-+.+.|+.|+..|.|.+|++.+|.......+|..+|+-+.-+.+|.++++.+... -.-+|++.+ +.+.+
T Consensus 1103 ~fTc~afs~~~~hL~vG~~~Geik~~nv~sG~~e~s~ncH~SavT~vePs~dgs~~Ltsss~S~PlsaLW~~~s~~~~~H 1182 (1516)
T KOG1832|consen 1103 LFTCIAFSGGTNHLAVGSHAGEIKIFNVSSGSMEESVNCHQSAVTLVEPSVDGSTQLTSSSSSSPLSALWDASSTGGPRH 1182 (1516)
T ss_pred ceeeEEeecCCceEEeeeccceEEEEEccCccccccccccccccccccccCCcceeeeeccccCchHHHhccccccCccc
Confidence 689999999999999999999999999999999999999999999999888999988776543 467999864 56677
Q ss_pred eecCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEE
Q 040274 146 TLTGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLG 209 (359)
Q Consensus 146 ~~~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~ 209 (359)
+|.. -.++.|+... -+.++......|||+.+. ....+|..........-+++.|+|+..+++
T Consensus 1183 sf~e-d~~vkFsn~~q~r~~gt~~d~a~~YDvqT~-~~l~tylt~~~~~~y~~n~a~FsP~D~LIl 1246 (1516)
T KOG1832|consen 1183 SFDE-DKAVKFSNSLQFRALGTEADDALLYDVQTC-SPLQTYLTDTVTSSYSNNLAHFSPCDTLIL 1246 (1516)
T ss_pred cccc-cceeehhhhHHHHHhcccccceEEEecccC-cHHHHhcCcchhhhhhccccccCCCcceEe
Confidence 7743 3567787766 344555577899997665 444444333221233446778888877665
No 296
>COG5354 Uncharacterized protein, contains Trp-Asp (WD) repeat [General function prediction only]
Probab=98.25 E-value=3.7e-05 Score=70.71 Aligned_cols=135 Identities=12% Similarity=0.164 Sum_probs=93.6
Q ss_pred eEEEEcCCCCEEEEEe-----------CCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEec--CCCeEEEEE
Q 040274 71 DLMRVNPFNGVVSLGH-----------SGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTG--KECKIKIWD 137 (359)
Q Consensus 71 ~~l~~sp~~~~l~tg~-----------~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~--~d~~i~vwd 137 (359)
..+.|++.|.+|++-- ....++|+++....+.... .-.++|...+|+|.++.|++++ .+-.+.++|
T Consensus 226 ~qLkW~~~g~~ll~l~~t~~ksnKsyfgesnLyl~~~~e~~i~V~~-~~~~pVhdf~W~p~S~~F~vi~g~~pa~~s~~~ 304 (561)
T COG5354 226 VQLKWQVLGKYLLVLVMTHTKSNKSYFGESNLYLLRITERSIPVEK-DLKDPVHDFTWEPLSSRFAVISGYMPASVSVFD 304 (561)
T ss_pred cEEEEecCCceEEEEEEEeeecccceeccceEEEEeecccccceec-cccccceeeeecccCCceeEEecccccceeecc
Confidence 4567888888765421 1235788887744433332 5689999999999888766554 688899999
Q ss_pred cCCCeeeEee-cCCceeEEEcCCC--cEEEEcC---CcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEE
Q 040274 138 LRKYEVLQTL-TGHAKTLDFSQKG--LLAVGTG---SFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIG 211 (359)
Q Consensus 138 ~~~~~~~~~~-~~~v~~~~~s~~g--l~~~~~d---~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g 211 (359)
++.. ....+ ...-+.+.|||.+ ++.++.| |.+.+||....-.....+.+. ...-+.|+||+.++.+.
T Consensus 305 lr~N-l~~~~Pe~~rNT~~fsp~~r~il~agF~nl~gni~i~~~~~rf~~~~~~~~~------n~s~~~wspd~qF~~~~ 377 (561)
T COG5354 305 LRGN-LRFYFPEQKRNTIFFSPHERYILFAGFDNLQGNIEIFDPAGRFKVAGAFNGL------NTSYCDWSPDGQFYDTD 377 (561)
T ss_pred cccc-eEEecCCcccccccccCcccEEEEecCCccccceEEeccCCceEEEEEeecC------CceEeeccCCceEEEec
Confidence 9966 55555 4556889999999 6666655 789999965443333344333 35567899999998876
Q ss_pred eC
Q 040274 212 HS 213 (359)
Q Consensus 212 ~~ 213 (359)
..
T Consensus 378 ~t 379 (561)
T COG5354 378 TT 379 (561)
T ss_pred CC
Confidence 54
No 297
>KOG1645 consensus RING-finger-containing E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=98.25 E-value=7e-06 Score=73.30 Aligned_cols=132 Identities=14% Similarity=0.062 Sum_probs=93.6
Q ss_pred eEEEECCCCCEEEEeccceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCC-EEEEecC
Q 040274 52 ILWILPSSGRYMAVAGRRTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGH-LMATTGK 129 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~-~l~s~~~ 129 (359)
|++..++..+.|..+- ...++..+. .+.-++.|- | |++.+..+.+...-+.+|...|.+++|+|..+ ++..++.
T Consensus 139 f~v~r~~gcrli~y~~-~~s~lv~sQks~qa~lpGv--G-v~~l~~~~fkssq~lp~~g~~IrdlafSp~~~GLl~~asl 214 (463)
T KOG1645|consen 139 FSVGRNAGCRLIGYDE-SSSTLVVSQKSGQALLPGV--G-VQKLESHDFKSSQILPGEGSFIRDLAFSPFNEGLLGLASL 214 (463)
T ss_pred eeeeecCCceEEeccc-ccceeeeeccchhhcCCcc--c-eEEeccCCcchhhcccccchhhhhhccCccccceeeeecc
Confidence 5555555554444432 122222222 222244443 3 88888877777777778899999999999766 7888999
Q ss_pred CCeEEEEEcCCCeeeEee--cCCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCcccccccc
Q 040274 130 ECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMG 187 (359)
Q Consensus 130 d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~ 187 (359)
+..|+|.|+++..++.++ ...+++++|.-+. +++|-..|.|.|||++........+..
T Consensus 215 ~nkiki~dlet~~~vssy~a~~~~wSC~wDlde~h~IYaGl~nG~VlvyD~R~~~~~~~e~~a 277 (463)
T KOG1645|consen 215 GNKIKIMDLETSCVVSSYIAYNQIWSCCWDLDERHVIYAGLQNGMVLVYDMRQPEGPLMELVA 277 (463)
T ss_pred CceEEEEecccceeeeheeccCCceeeeeccCCcceeEEeccCceEEEEEccCCCchHhhhhh
Confidence 999999999998887777 5568999999887 667777899999999877655544433
No 298
>KOG1409 consensus Uncharacterized conserved protein, contains WD40 repeats and FYVE domains [Function unknown]
Probab=98.25 E-value=3.2e-05 Score=67.86 Aligned_cols=96 Identities=20% Similarity=0.357 Sum_probs=71.3
Q ss_pred EEEEEeCCCeEEEEeC--CCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeee-Eee---cCCceeE
Q 040274 81 VVSLGHSGGTVTMWKP--TTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVL-QTL---TGHAKTL 154 (359)
Q Consensus 81 ~l~tg~~dg~v~lwd~--~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~-~~~---~~~v~~~ 154 (359)
+...|...|.|.+-.+ ..-.++.++.+|.+.+++++|.|....|++|..|..+.+||+--..-+ ..+ ...|..+
T Consensus 167 ~~fvGd~~gqvt~lr~~~~~~~~i~~~~~h~~~~~~l~Wd~~~~~LfSg~~d~~vi~wdigg~~g~~~el~gh~~kV~~l 246 (404)
T KOG1409|consen 167 YAFVGDHSGQITMLKLEQNGCQLITTFNGHTGEVTCLKWDPGQRLLFSGASDHSVIMWDIGGRKGTAYELQGHNDKVQAL 246 (404)
T ss_pred EEEecccccceEEEEEeecCCceEEEEcCcccceEEEEEcCCCcEEEeccccCceEEEeccCCcceeeeeccchhhhhhh
Confidence 3344555565655543 344678889999999999999999999999999999999999754322 222 3346666
Q ss_pred EEcCCC--cEEEEcCCcEEEEcCC
Q 040274 155 DFSQKG--LLAVGTGSFAQILGDF 176 (359)
Q Consensus 155 ~~s~~g--l~~~~~d~~i~v~d~~ 176 (359)
++-+.- +++++.||.|.+||+.
T Consensus 247 ~~~~~t~~l~S~~edg~i~~w~mn 270 (404)
T KOG1409|consen 247 SYAQHTRQLISCGEDGGIVVWNMN 270 (404)
T ss_pred hhhhhheeeeeccCCCeEEEEecc
Confidence 665554 8899999999999975
No 299
>KOG1912 consensus WD40 repeat protein [General function prediction only]
Probab=98.24 E-value=7.1e-05 Score=72.25 Aligned_cols=106 Identities=10% Similarity=0.148 Sum_probs=81.1
Q ss_pred eEEEECCCCCEEEEecc----------------------ceeEEEEcCCC------------CEEEEEeCCCeEEEEeCC
Q 040274 52 ILWILPSSGRYMAVAGR----------------------RTDLMRVNPFN------------GVVSLGHSGGTVTMWKPT 97 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~----------------------~v~~l~~sp~~------------~~l~tg~~dg~v~lwd~~ 97 (359)
..++|+|.| .||.|+. .|+.+.|.|-. -.|+++.-.|.|.+||..
T Consensus 19 ~A~Dw~~~G-LiAygshslV~VVDs~s~q~iqsie~h~s~V~~VrWap~~~p~~llS~~~~~lliAsaD~~GrIil~d~~ 97 (1062)
T KOG1912|consen 19 NAADWSPSG-LIAYGSHSLVSVVDSRSLQLIQSIELHQSAVTSVRWAPAPSPRDLLSPSSSQLLIASADISGRIILVDFV 97 (1062)
T ss_pred cccccCccc-eEEEecCceEEEEehhhhhhhhccccCccceeEEEeccCCCchhccCccccceeEEeccccCcEEEEEeh
Confidence 567788887 4566555 78999997732 146777788999999999
Q ss_pred CCcceEEeecCCCCeEEEEEec---CC-CEEEEecCCCeEEEEEcCCCeeeEeec---CCceeEEEcC
Q 040274 98 TSALLIKMLYHQGPVSALAFHP---NG-HLMATTGKECKIKIWDLRKYEVLQTLT---GHAKTLDFSQ 158 (359)
Q Consensus 98 ~~~~~~~~~~h~~~v~~l~~~p---~g-~~l~s~~~d~~i~vwd~~~~~~~~~~~---~~v~~~~~s~ 158 (359)
.+..+..+..|..++..++|-+ +. ..|+.-....+|.+|+..+|+.+..+. ....|+.+.|
T Consensus 98 ~~s~~~~l~~~~~~~qdl~W~~~rd~Srd~LlaIh~ss~lvLwntdtG~k~Wk~~ys~~iLs~f~~DP 165 (1062)
T KOG1912|consen 98 LASVINWLSHSNDSVQDLCWVPARDDSRDVLLAIHGSSTLVLWNTDTGEKFWKYDYSHEILSCFRVDP 165 (1062)
T ss_pred hhhhhhhhcCCCcchhheeeeeccCcchheeEEecCCcEEEEEEccCCceeeccccCCcceeeeeeCC
Confidence 9988888989999999999976 33 356677777899999999998877772 2235566665
No 300
>KOG2041 consensus WD40 repeat protein [General function prediction only]
Probab=98.24 E-value=1.6e-05 Score=75.95 Aligned_cols=168 Identities=12% Similarity=0.136 Sum_probs=119.9
Q ss_pred eEEEECCCCCEEEEecc--------------------------------------ceeEEEEcCCCCEEEEEeCCCeEEE
Q 040274 52 ILWILPSSGRYMAVAGR--------------------------------------RTDLMRVNPFNGVVSLGHSGGTVTM 93 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~--------------------------------------~v~~l~~sp~~~~l~tg~~dg~v~l 93 (359)
.|+.|.....|+++||. +|..+.|+..++.|.|...+|.|.+
T Consensus 18 ~c~~WNke~gyIAcgG~dGlLKVlKl~t~t~d~~~~glaa~snLsmNQtLeGH~~sV~vvTWNe~~QKLTtSDt~GlIiV 97 (1189)
T KOG2041|consen 18 HCAEWNKESGYIACGGADGLLKVLKLGTDTTDLNKSGLAAASNLSMNQTLEGHNASVMVVTWNENNQKLTTSDTSGLIIV 97 (1189)
T ss_pred EEEEEcccCCeEEeccccceeEEEEccccCCcccccccccccccchhhhhccCcceEEEEEeccccccccccCCCceEEE
Confidence 78999999999999987 7899999999999999999999999
Q ss_pred EeCCCCcceEEee--cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeee-EeecC-CceeEEEcCCC--cEEEEcC
Q 040274 94 WKPTTSALLIKML--YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVL-QTLTG-HAKTLDFSQKG--LLAVGTG 167 (359)
Q Consensus 94 wd~~~~~~~~~~~--~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~-~~~~~-~v~~~~~s~~g--l~~~~~d 167 (359)
|=+-.+.....+. ...+.|.+++|+.+|..++..-.||.|.|=.+...... ..+.+ +...+.||+|. ++.+-..
T Consensus 98 WmlykgsW~EEMiNnRnKSvV~SmsWn~dG~kIcIvYeDGavIVGsvdGNRIwgKeLkg~~l~hv~ws~D~~~~Lf~~an 177 (1189)
T KOG2041|consen 98 WMLYKGSWCEEMINNRNKSVVVSMSWNLDGTKICIVYEDGAVIVGSVDGNRIWGKELKGQLLAHVLWSEDLEQALFKKAN 177 (1189)
T ss_pred EeeecccHHHHHhhCcCccEEEEEEEcCCCcEEEEEEccCCEEEEeeccceecchhcchheccceeecccHHHHHhhhcC
Confidence 9887775443332 34567999999999999999999999888766543221 12222 45688999998 5666667
Q ss_pred CcEEEEcCCCCCcc-------ccccccccCCCCcceeEEEEc--------cCCCEEEEEeCCCeEEEE
Q 040274 168 SFAQILGDFSGSHN-------YSRYMGNSMVKGYQIGKVSFR--------PYEDVLGIGHSMGWSGIL 220 (359)
Q Consensus 168 ~~i~v~d~~~~~~~-------~~~~~~~~~~~~~~v~~~~~s--------p~~~~l~~g~~dg~~~i~ 220 (359)
|.+++||....-.. +........ .+..|..+.|. |+...|+++..+|.+.|.
T Consensus 178 ge~hlydnqgnF~~Kl~~~c~Vn~tg~~s~-~~~kia~i~w~~g~~~~v~pdrP~lavcy~nGr~QiM 244 (1189)
T KOG2041|consen 178 GETHLYDNQGNFERKLEKDCEVNGTGIFSN-FPTKIAEIEWNTGPYQPVPPDRPRLAVCYANGRMQIM 244 (1189)
T ss_pred CcEEEecccccHHHhhhhceEEeeeeeecC-CCccccceeeccCccccCCCCCCEEEEEEcCceehhh
Confidence 89999995332100 000000000 11235556654 588899999999987764
No 301
>KOG3914 consensus WD repeat protein WDR4 [Function unknown]
Probab=98.22 E-value=2.7e-05 Score=69.52 Aligned_cols=159 Identities=11% Similarity=0.014 Sum_probs=99.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcc----eEEeecCCCCeEEEEEecCCCEEEEe---cCCCeEEEEEcCCC
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSAL----LIKMLYHQGPVSALAFHPNGHLMATT---GKECKIKIWDLRKY 141 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~----~~~~~~h~~~v~~l~~~p~g~~l~s~---~~d~~i~vwd~~~~ 141 (359)
....+..+|++.++|++..+....+++...... +..+ +-...-+++.|..+......+ +....+.+|....+
T Consensus 64 a~~~~~~s~~~~llAv~~~~K~~~~f~~~~~~~~~kl~~~~-~v~~~~~ai~~~~~~~sv~v~dkagD~~~~di~s~~~~ 142 (390)
T KOG3914|consen 64 APALVLTSDSGRLVAVATSSKQRAVFDYRENPKGAKLLDVS-CVPKRPTAISFIREDTSVLVADKAGDVYSFDILSADSG 142 (390)
T ss_pred cccccccCCCceEEEEEeCCCceEEEEEecCCCcceeeeEe-ecccCcceeeeeeccceEEEEeecCCceeeeeeccccc
Confidence 455667788999999998877766666553322 2222 223333555555555444444 44455556655544
Q ss_pred eeeEee--cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeE
Q 040274 142 EVLQTL--TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWS 217 (359)
Q Consensus 142 ~~~~~~--~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~ 217 (359)
.+...+ -.-+++++|+||+ ++++..|..|+|-........-..+.+|.. -|..++..++ ..|++|+.|+++
T Consensus 143 ~~~~~lGhvSml~dVavS~D~~~IitaDRDEkIRvs~ypa~f~IesfclGH~e----FVS~isl~~~-~~LlS~sGD~tl 217 (390)
T KOG3914|consen 143 RCEPILGHVSMLLDVAVSPDDQFIITADRDEKIRVSRYPATFVIESFCLGHKE----FVSTISLTDN-YLLLSGSGDKTL 217 (390)
T ss_pred CcchhhhhhhhhheeeecCCCCEEEEecCCceEEEEecCcccchhhhccccHh----heeeeeeccC-ceeeecCCCCcE
Confidence 443333 2336899999999 788888999998764443223334455654 6888887765 458999999999
Q ss_pred EEEEcCCCCCceeeecc
Q 040274 218 GILVPRSSEPNFDSWVA 234 (359)
Q Consensus 218 ~i~~~gs~~~~~~~~~~ 234 (359)
++|.-.++..- +.+++
T Consensus 218 r~Wd~~sgk~L-~t~dl 233 (390)
T KOG3914|consen 218 RLWDITSGKLL-DTCDL 233 (390)
T ss_pred EEEecccCCcc-cccch
Confidence 99876665432 44443
No 302
>PF04762 IKI3: IKI3 family; InterPro: IPR006849 Members of this family are components of the elongator multi-subunit component of a novel RNA polymerase II holoenzyme for transcriptional elongation [].
Probab=98.21 E-value=8.8e-05 Score=76.40 Aligned_cols=172 Identities=12% Similarity=0.171 Sum_probs=111.7
Q ss_pred eEEEECCCCCEEEEecc----------------------------ceeEEEEcCCCCEEEEEeC---CCeEEEEeCCC--
Q 040274 52 ILWILPSSGRYMAVAGR----------------------------RTDLMRVNPFNGVVSLGHS---GGTVTMWKPTT-- 98 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~----------------------------~v~~l~~sp~~~~l~tg~~---dg~v~lwd~~~-- 98 (359)
..++|-.||.|+|+.+- --.+++|-|.|++||+... ...|.+|.-+.
T Consensus 213 ~~ISWRGDG~yFAVss~~~~~~~~R~iRVy~ReG~L~stSE~v~gLe~~l~WrPsG~lIA~~q~~~~~~~VvFfErNGLr 292 (928)
T PF04762_consen 213 VRISWRGDGEYFAVSSVEPETGSRRVIRVYSREGELQSTSEPVDGLEGALSWRPSGNLIASSQRLPDRHDVVFFERNGLR 292 (928)
T ss_pred eEEEECCCCcEEEEEEEEcCCCceeEEEEECCCceEEeccccCCCccCCccCCCCCCEEEEEEEcCCCcEEEEEecCCcE
Confidence 88899999999987553 3468899999999998764 34566776432
Q ss_pred -CcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCee--eEee----cCCceeEEEcCCC---cEEEEcCC
Q 040274 99 -SALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEV--LQTL----TGHAKTLDFSQKG---LLAVGTGS 168 (359)
Q Consensus 99 -~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~--~~~~----~~~v~~~~~s~~g---l~~~~~d~ 168 (359)
|+....+......|..+.|++|+..||....|. |.+|-..++.- .+.+ ...+..+.|+|.. +...+.+|
T Consensus 293 hgeF~l~~~~~~~~v~~l~Wn~ds~iLAv~~~~~-vqLWt~~NYHWYLKqei~~~~~~~~~~~~Wdpe~p~~L~v~t~~g 371 (928)
T PF04762_consen 293 HGEFTLRFDPEEEKVIELAWNSDSEILAVWLEDR-VQLWTRSNYHWYLKQEIRFSSSESVNFVKWDPEKPLRLHVLTSNG 371 (928)
T ss_pred eeeEecCCCCCCceeeEEEECCCCCEEEEEecCC-ceEEEeeCCEEEEEEEEEccCCCCCCceEECCCCCCEEEEEecCC
Confidence 222222223456899999999999999977666 99998877642 2233 1234558898865 44455445
Q ss_pred cEEEEcC----CCCC--------------------------ccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEE
Q 040274 169 FAQILGD----FSGS--------------------------HNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSG 218 (359)
Q Consensus 169 ~i~v~d~----~~~~--------------------------~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~ 218 (359)
.+..++. ..+. ..+.+...........|.+++|++++..+++-..||.+.
T Consensus 372 ~~~~~~~~~~v~~s~~~~~~D~g~vaVIDG~~lllTpf~~a~VPPPMs~~~l~~~~~v~~vaf~~~~~~~avl~~d~~l~ 451 (928)
T PF04762_consen 372 QYEIYDFAWDVSRSPGSSPNDNGTVAVIDGNKLLLTPFRRAVVPPPMSSYELELPSPVNDVAFSPSNSRFAVLTSDGSLS 451 (928)
T ss_pred cEEEEEEEEEEEecCCCCccCceEEEEEeCCeEEEecccccCCCchHhceEEcCCCCcEEEEEeCCCCeEEEEECCCCEE
Confidence 5544332 1110 000011011111234799999999998899999999888
Q ss_pred EEEcCC
Q 040274 219 ILVPRS 224 (359)
Q Consensus 219 i~~~gs 224 (359)
+|....
T Consensus 452 ~~~~~~ 457 (928)
T PF04762_consen 452 IYEWDL 457 (928)
T ss_pred EEEecC
Confidence 887443
No 303
>PF07433 DUF1513: Protein of unknown function (DUF1513); InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=98.20 E-value=0.00029 Score=62.28 Aligned_cols=152 Identities=14% Similarity=0.137 Sum_probs=97.7
Q ss_pred EEEECCCCCEEEEecc-----------------------------ceeEEEEcCCCCEEEEEe-----------------
Q 040274 53 LWILPSSGRYMAVAGR-----------------------------RTDLMRVNPFNGVVSLGH----------------- 86 (359)
Q Consensus 53 ~l~~spdg~~l~~~~~-----------------------------~v~~l~~sp~~~~l~tg~----------------- 86 (359)
.-.||+||++|.+.-. .-+.|.+.||+..|+++.
T Consensus 55 Hg~fs~dG~~LytTEnd~~~g~G~IgVyd~~~~~~ri~E~~s~GIGPHel~l~pDG~tLvVANGGI~Thpd~GR~kLNl~ 134 (305)
T PF07433_consen 55 HGVFSPDGRLLYTTENDYETGRGVIGVYDAARGYRRIGEFPSHGIGPHELLLMPDGETLVVANGGIETHPDSGRAKLNLD 134 (305)
T ss_pred CEEEcCCCCEEEEeccccCCCcEEEEEEECcCCcEEEeEecCCCcChhhEEEcCCCCEEEEEcCCCccCcccCceecChh
Confidence 4568899998887543 567788899997777653
Q ss_pred -CCCeEEEEeCCCCcceEE--e--ecCCCCeEEEEEecCCCEEEEecCCC-------eEEEEEcCCCeeeEee-------
Q 040274 87 -SGGTVTMWKPTTSALLIK--M--LYHQGPVSALAFHPNGHLMATTGKEC-------KIKIWDLRKYEVLQTL------- 147 (359)
Q Consensus 87 -~dg~v~lwd~~~~~~~~~--~--~~h~~~v~~l~~~p~g~~l~s~~~d~-------~i~vwd~~~~~~~~~~------- 147 (359)
.+.++.+.|..+|+.+.. + ..|.-.|..++++++|..++..-..| -|-+++.. ..+..+
T Consensus 135 tM~psL~~ld~~sG~ll~q~~Lp~~~~~lSiRHLa~~~~G~V~~a~Q~qg~~~~~~PLva~~~~g--~~~~~~~~p~~~~ 212 (305)
T PF07433_consen 135 TMQPSLVYLDARSGALLEQVELPPDLHQLSIRHLAVDGDGTVAFAMQYQGDPGDAPPLVALHRRG--GALRLLPAPEEQW 212 (305)
T ss_pred hcCCceEEEecCCCceeeeeecCccccccceeeEEecCCCcEEEEEecCCCCCccCCeEEEEcCC--CcceeccCChHHH
Confidence 133466677788877665 4 23777899999999987655443222 24444433 222222
Q ss_pred ---cCCceeEEEcCCC-cEEEE--cCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 148 ---TGHAKTLDFSQKG-LLAVG--TGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 148 ---~~~v~~~~~s~~g-l~~~~--~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
.+.+-+|+++++| +++++ ..+.+.+||..++ ..+....-. .++.++-.+++ ++++.+..
T Consensus 213 ~~l~~Y~gSIa~~~~g~~ia~tsPrGg~~~~~d~~tg-~~~~~~~l~------D~cGva~~~~~-f~~ssG~G 277 (305)
T PF07433_consen 213 RRLNGYIGSIAADRDGRLIAVTSPRGGRVAVWDAATG-RLLGSVPLP------DACGVAPTDDG-FLVSSGQG 277 (305)
T ss_pred HhhCCceEEEEEeCCCCEEEEECCCCCEEEEEECCCC-CEeeccccC------ceeeeeecCCc-eEEeCCCc
Confidence 4668999999999 55444 4689999995544 443333332 47777777776 55544443
No 304
>KOG1008 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=98.16 E-value=7.2e-07 Score=83.85 Aligned_cols=152 Identities=9% Similarity=0.091 Sum_probs=101.3
Q ss_pred ceeEEEEcC-CCCEEEEEe----CCCeEEEEeCCCC--cce--EEeec-CCCCeEEEEEecCCCEEEEecCCCeEEEEEc
Q 040274 69 RTDLMRVNP-FNGVVSLGH----SGGTVTMWKPTTS--ALL--IKMLY-HQGPVSALAFHPNGHLMATTGKECKIKIWDL 138 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~----~dg~v~lwd~~~~--~~~--~~~~~-h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~ 138 (359)
.|++++|++ |.++||.|. .|..+.|||+.++ .|. ..|.+ -.....+++|..+.+++.+|.....+.++|+
T Consensus 104 ~Ct~lAwneLDtn~LAagldkhrnds~~~Iwdi~s~ltvPke~~~fs~~~l~gqns~cwlrd~klvlaGm~sr~~~ifdl 183 (783)
T KOG1008|consen 104 PCTSLAWNELDTNHLAAGLDKHRNDSSLKIWDINSLLTVPKESPLFSSSTLDGQNSVCWLRDTKLVLAGMTSRSVHIFDL 183 (783)
T ss_pred cccccccccccHHHHHhhhhhhcccCCccceecccccCCCccccccccccccCccccccccCcchhhcccccchhhhhhh
Confidence 899999999 777888885 4678999999876 222 22322 3345678999989999999999999999999
Q ss_pred CCC-eeeEeec-CCceeEEEcC-CC-cEEEEcCCcEEEEcC-CCCCccccccccccCCCCcceeEEEEccCC-CEEEEEe
Q 040274 139 RKY-EVLQTLT-GHAKTLDFSQ-KG-LLAVGTGSFAQILGD-FSGSHNYSRYMGNSMVKGYQIGKVSFRPYE-DVLGIGH 212 (359)
Q Consensus 139 ~~~-~~~~~~~-~~v~~~~~s~-~g-l~~~~~d~~i~v~d~-~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~-~~l~~g~ 212 (359)
|.. .....+. ..+..+..+| .+ +++...||.|-+||. ......+..+..........+..++|+|.. ..|++.+
T Consensus 184 Rqs~~~~~svnTk~vqG~tVdp~~~nY~cs~~dg~iAiwD~~rnienpl~~i~~~~N~~~~~l~~~aycPtrtglla~l~ 263 (783)
T KOG1008|consen 184 RQSLDSVSSVNTKYVQGITVDPFSPNYFCSNSDGDIAIWDTYRNIENPLQIILRNENKKPKQLFALAYCPTRTGLLAVLS 263 (783)
T ss_pred hhhhhhhhhhhhhhcccceecCCCCCceeccccCceeeccchhhhccHHHHHhhCCCCcccceeeEEeccCCcchhhhhc
Confidence 942 2233332 3466777888 44 888888999999994 333233322222111011248999999964 3344444
Q ss_pred C-CCeEEEE
Q 040274 213 S-MGWSGIL 220 (359)
Q Consensus 213 ~-dg~~~i~ 220 (359)
. .++++.+
T Consensus 264 RdS~tIrly 272 (783)
T KOG1008|consen 264 RDSITIRLY 272 (783)
T ss_pred cCcceEEEe
Confidence 4 4556654
No 305
>KOG4714 consensus Nucleoporin [Nuclear structure]
Probab=98.12 E-value=9.3e-06 Score=68.58 Aligned_cols=140 Identities=11% Similarity=0.061 Sum_probs=88.8
Q ss_pred CCEEEEEeCCCeEEEEeCCCCcc-eEEeecCCCCeEEEEEecCCCEEEEecC-----CCeEEEEEcCCCeeeEee---cC
Q 040274 79 NGVVSLGHSGGTVTMWKPTTSAL-LIKMLYHQGPVSALAFHPNGHLMATTGK-----ECKIKIWDLRKYEVLQTL---TG 149 (359)
Q Consensus 79 ~~~l~tg~~dg~v~lwd~~~~~~-~~~~~~h~~~v~~l~~~p~g~~l~s~~~-----d~~i~vwd~~~~~~~~~~---~~ 149 (359)
++-++++..||.+-+.+.+.--. ...+..-.....+.++...++++.+++. -+..+.|+++....+..- ..
T Consensus 101 ~t~V~~~~~dg~~~v~s~~~~~~~~~~i~~~~~~~as~~~~~~~~~i~s~~~g~~n~~d~~~a~~~~p~~t~~~~~~~~~ 180 (319)
T KOG4714|consen 101 DNRVCIGYADGSLAVFSTDKDLALMSRIPSIHSGSASRKICRHGNSILSGGCGNWNAQDNFYANTLDPIKTLIPSKKALD 180 (319)
T ss_pred CCceEecCCCceEEEEechHHHhhhhhcccccccccccceeecccEEecCCcceEeeccceeeecccccccccccccccc
Confidence 45688899999999998764111 1111111111223333345555544332 234667776643221111 23
Q ss_pred CceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEcc-CCCEEEEEeCCCeEEEEEc
Q 040274 150 HAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRP-YEDVLGIGHSMGWSGILVP 222 (359)
Q Consensus 150 ~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp-~~~~l~~g~~dg~~~i~~~ 222 (359)
.|++++-+|.. +++++.||.+.+||.++...+...+..|.. .++.+.|+| ++..|++++.||.+-.|..
T Consensus 181 ~v~~l~~hp~qq~~v~cgt~dg~~~l~d~rn~~~p~S~l~ahk~----~i~eV~FHpk~p~~Lft~sedGslw~wda 253 (319)
T KOG4714|consen 181 AVTALCSHPAQQHLVCCGTDDGIVGLWDARNVAMPVSLLKAHKA----EIWEVHFHPKNPEHLFTCSEDGSLWHWDA 253 (319)
T ss_pred cchhhhCCcccccEEEEecCCCeEEEEEcccccchHHHHHHhhh----hhhheeccCCCchheeEecCCCcEEEEcC
Confidence 48888888876 556667899999998887666777777765 899999999 5688999999997666544
No 306
>COG0823 TolB Periplasmic component of the Tol biopolymer transport system [Intracellular trafficking and secretion]
Probab=98.07 E-value=8.3e-05 Score=69.92 Aligned_cols=140 Identities=16% Similarity=0.246 Sum_probs=85.7
Q ss_pred ceeEEEEcCCCCEEEEEe-CCCe--EEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecC-CC--eEEEEEcCCCe
Q 040274 69 RTDLMRVNPFNGVVSLGH-SGGT--VTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGK-EC--KIKIWDLRKYE 142 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~-~dg~--v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~-d~--~i~vwd~~~~~ 142 (359)
.-...+|+|||..|+.++ .||. |.++|+.++. +..+....+.-+.-.|+|||+.++..+. .| .|.++|+..+.
T Consensus 239 ~~~~P~fspDG~~l~f~~~rdg~~~iy~~dl~~~~-~~~Lt~~~gi~~~Ps~spdG~~ivf~Sdr~G~p~I~~~~~~g~~ 317 (425)
T COG0823 239 NNGAPAFSPDGSKLAFSSSRDGSPDIYLMDLDGKN-LPRLTNGFGINTSPSWSPDGSKIVFTSDRGGRPQIYLYDLEGSQ 317 (425)
T ss_pred ccCCccCCCCCCEEEEEECCCCCccEEEEcCCCCc-ceecccCCccccCccCCCCCCEEEEEeCCCCCcceEEECCCCCc
Confidence 455678999998766554 5664 6666777665 3335444455557899999999877654 34 47777777665
Q ss_pred eeE-eec-CCceeEEEcCCC--cEEEEc-CCc--EEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 143 VLQ-TLT-GHAKTLDFSQKG--LLAVGT-GSF--AQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 143 ~~~-~~~-~~v~~~~~s~~g--l~~~~~-d~~--i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
... +.. +.-....||||| ++..+. +|. |.++|+..+.. .. ..... ......+|.|+|..+...+..+
T Consensus 318 ~~riT~~~~~~~~p~~SpdG~~i~~~~~~~g~~~i~~~~~~~~~~-~~-~lt~~----~~~e~ps~~~ng~~i~~~s~~~ 391 (425)
T COG0823 318 VTRLTFSGGGNSNPVWSPDGDKIVFESSSGGQWDIDKNDLASGGK-IR-ILTST----YLNESPSWAPNGRMIMFSSGQG 391 (425)
T ss_pred eeEeeccCCCCcCccCCCCCCEEEEEeccCCceeeEEeccCCCCc-EE-Ecccc----ccCCCCCcCCCCceEEEeccCC
Confidence 422 222 223478899999 443332 444 66676544432 22 22221 1355667888888877666555
No 307
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=98.04 E-value=0.00054 Score=62.52 Aligned_cols=88 Identities=8% Similarity=-0.019 Sum_probs=68.2
Q ss_pred CeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecC----------CCeEEEEEcCCCeeeEeecCC--------
Q 040274 89 GTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGK----------ECKIKIWDLRKYEVLQTLTGH-------- 150 (359)
Q Consensus 89 g~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~----------d~~i~vwd~~~~~~~~~~~~~-------- 150 (359)
+.|.+.|..+++.+..+.....+- .+ ++|||+.|+.+.. +..|.+||..+++.+..+..+
T Consensus 27 ~~v~ViD~~~~~v~g~i~~G~~P~-~~-~spDg~~lyva~~~~~R~~~G~~~d~V~v~D~~t~~~~~~i~~p~~p~~~~~ 104 (352)
T TIGR02658 27 TQVYTIDGEAGRVLGMTDGGFLPN-PV-VASDGSFFAHASTVYSRIARGKRTDYVEVIDPQTHLPIADIELPEGPRFLVG 104 (352)
T ss_pred ceEEEEECCCCEEEEEEEccCCCc-ee-ECCCCCEEEEEeccccccccCCCCCEEEEEECccCcEEeEEccCCCchhhcc
Confidence 899999999999888887544443 34 9999998877766 788999999999999888421
Q ss_pred --ceeEEEcCCC-cEE-EE-c-CCcEEEEcCCCC
Q 040274 151 --AKTLDFSQKG-LLA-VG-T-GSFAQILGDFSG 178 (359)
Q Consensus 151 --v~~~~~s~~g-l~~-~~-~-d~~i~v~d~~~~ 178 (359)
...+++|||| ++. .. . ++.|.++|+...
T Consensus 105 ~~~~~~~ls~dgk~l~V~n~~p~~~V~VvD~~~~ 138 (352)
T TIGR02658 105 TYPWMTSLTPDNKTLLFYQFSPSPAVGVVDLEGK 138 (352)
T ss_pred CccceEEECCCCCEEEEecCCCCCEEEEEECCCC
Confidence 2488999999 444 33 2 689999996554
No 308
>KOG4640 consensus Anaphase-promoting complex (APC), subunit 4 [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=98.02 E-value=2.6e-05 Score=73.56 Aligned_cols=89 Identities=17% Similarity=0.231 Sum_probs=78.2
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeE-EEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVS-ALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~-~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~ 147 (359)
.+--+.|+|.-.+||++..+|.|-++.++ .+.+.++.-|...++ +++|.|||++||.|-.||+|++.|+.++..+...
T Consensus 22 ~i~~~ewnP~~dLiA~~t~~gelli~R~n-~qRlwtip~p~~~v~~sL~W~~DGkllaVg~kdG~I~L~Dve~~~~l~~~ 100 (665)
T KOG4640|consen 22 NIKRIEWNPKMDLIATRTEKGELLIHRLN-WQRLWTIPIPGENVTASLCWRPDGKLLAVGFKDGTIRLHDVEKGGRLVSF 100 (665)
T ss_pred ceEEEEEcCccchhheeccCCcEEEEEec-cceeEeccCCCCccceeeeecCCCCEEEEEecCCeEEEEEccCCCceecc
Confidence 47788999999999999999999999888 788889887787777 9999999999999999999999999999887773
Q ss_pred ----cCCceeEEEcC
Q 040274 148 ----TGHAKTLDFSQ 158 (359)
Q Consensus 148 ----~~~v~~~~~s~ 158 (359)
...|+++-|++
T Consensus 101 ~~s~e~~is~~~w~~ 115 (665)
T KOG4640|consen 101 LFSVETDISKGIWDR 115 (665)
T ss_pred ccccccchheeeccc
Confidence 45678888864
No 309
>COG5170 CDC55 Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=98.02 E-value=4.4e-05 Score=66.19 Aligned_cols=152 Identities=14% Similarity=0.161 Sum_probs=103.1
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCC---cceEEeecCC-----CCeEEEEEecC-CCEEEEecCCCeEEEEEcC
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTS---ALLIKMLYHQ-----GPVSALAFHPN-GHLMATTGKECKIKIWDLR 139 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~---~~~~~~~~h~-----~~v~~l~~~p~-g~~l~s~~~d~~i~vwd~~ 139 (359)
.++++.|+.|...++++ .|=.|.+|++.-. -.+..++.|. .-|++..|+|. .+.+..++..|.|++-|+|
T Consensus 174 hiNSiS~NsD~et~lSa-DdLrINLWnl~i~D~sFnIVDiKP~nmeeLteVItSaeFhp~~cn~fmYSsSkG~Ikl~DlR 252 (460)
T COG5170 174 HINSISFNSDKETLLSA-DDLRINLWNLEIIDGSFNIVDIKPHNMEELTEVITSAEFHPEMCNVFMYSSSKGEIKLNDLR 252 (460)
T ss_pred EeeeeeecCchheeeec-cceeeeeccccccCCceEEEeccCccHHHHHHHHhhcccCHhHcceEEEecCCCcEEehhhh
Confidence 68999999988877776 4678999997632 2244455554 35889999994 3456677788999999998
Q ss_pred CCee------eEee-------------cCCceeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccC--------C
Q 040274 140 KYEV------LQTL-------------TGHAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSM--------V 191 (359)
Q Consensus 140 ~~~~------~~~~-------------~~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~--------~ 191 (359)
.... +... ...|..+.|+++| ++.+-.-.+|.|||+.....++.+++.|.. .
T Consensus 253 q~alcdn~~klfe~~~D~v~~~ff~eivsSISD~kFs~ngryIlsRdyltvkiwDvnm~k~pikTi~~h~~l~~~l~d~Y 332 (460)
T COG5170 253 QSALCDNSKKLFELTIDGVDVDFFEEIVSSISDFKFSDNGRYILSRDYLTVKIWDVNMAKNPIKTIPMHCDLMDELNDVY 332 (460)
T ss_pred hhhhccCchhhhhhccCcccchhHHHHhhhhcceEEcCCCcEEEEeccceEEEEecccccCCceeechHHHHHHHHHhhh
Confidence 5321 1110 1347889999999 666666689999998766555555433311 0
Q ss_pred CCcc---eeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 192 KGYQ---IGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 192 ~~~~---v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
.... -..+.||.|...+++|+......|+-
T Consensus 333 EnDaifdkFeisfSgd~~~v~sgsy~NNfgiyp 365 (460)
T COG5170 333 ENDAIFDKFEISFSGDDKHVLSGSYSNNFGIYP 365 (460)
T ss_pred hccceeeeEEEEecCCcccccccccccceeeec
Confidence 0111 23578888888888888877655553
No 310
>PF00400 WD40: WD domain, G-beta repeat; InterPro: IPR019781 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events.; PDB: 2ZKQ_a 3CFV_B 3CFS_B 1PEV_A 1NR0_A 1VYH_T 3RFH_A 3O2Z_T 3FRX_C 3U5G_g ....
Probab=98.01 E-value=1.3e-05 Score=48.14 Aligned_cols=27 Identities=22% Similarity=0.511 Sum_probs=26.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEe
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWK 95 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd 95 (359)
.|++|+|+|++.+|++|+.|+.|++||
T Consensus 13 ~i~~i~~~~~~~~~~s~~~D~~i~vwd 39 (39)
T PF00400_consen 13 SINSIAWSPDGNFLASGSSDGTIRVWD 39 (39)
T ss_dssp SEEEEEEETTSSEEEEEETTSEEEEEE
T ss_pred cEEEEEEecccccceeeCCCCEEEEEC
Confidence 799999999999999999999999997
No 311
>KOG2066 consensus Vacuolar assembly/sorting protein VPS41 [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.00 E-value=0.00037 Score=67.71 Aligned_cols=135 Identities=13% Similarity=0.108 Sum_probs=90.8
Q ss_pred CCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecC-----CCEEEEecCCCeEEEEEcCCC-----eeeEee
Q 040274 78 FNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPN-----GHLMATTGKECKIKIWDLRKY-----EVLQTL 147 (359)
Q Consensus 78 ~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~-----g~~l~s~~~d~~i~vwd~~~~-----~~~~~~ 147 (359)
+|.++++||.||+|.|-.+.+.+...++. -..++.+++++|+ .+.+++||..| +.++.-+-. ..++.-
T Consensus 82 ~Gey~asCS~DGkv~I~sl~~~~~~~~~d-f~rpiksial~Pd~~~~~sk~fv~GG~ag-lvL~er~wlgnk~~v~l~~~ 159 (846)
T KOG2066|consen 82 EGEYVASCSDDGKVVIGSLFTDDEITQYD-FKRPIKSIALHPDFSRQQSKQFVSGGMAG-LVLSERNWLGNKDSVVLSEG 159 (846)
T ss_pred CCceEEEecCCCcEEEeeccCCccceeEe-cCCcceeEEeccchhhhhhhheeecCcce-EEEehhhhhcCccceeeecC
Confidence 68999999999999999988877666553 3567899999997 56799999988 777754321 123444
Q ss_pred cCCceeEEEcCCCcEEEEcCCcEEEEcCCCCCccccccccccC-CCCcceeEEEEccCCCEEEEEeCCCe
Q 040274 148 TGHAKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYMGNSM-VKGYQIGKVSFRPYEDVLGIGHSMGW 216 (359)
Q Consensus 148 ~~~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~~~~~-~~~~~v~~~~~sp~~~~l~~g~~dg~ 216 (359)
.|+|.++.|..+ +++-..|-.|+|||+.........-..+.. .+..-...+.|.+.. .|++|-.|.+
T Consensus 160 eG~I~~i~W~g~-lIAWand~Gv~vyd~~~~~~l~~i~~p~~~~R~e~fpphl~W~~~~-~LVIGW~d~v 227 (846)
T KOG2066|consen 160 EGPIHSIKWRGN-LIAWANDDGVKVYDTPTRQRLTNIPPPSQSVRPELFPPHLHWQDED-RLVIGWGDSV 227 (846)
T ss_pred ccceEEEEecCc-EEEEecCCCcEEEeccccceeeccCCCCCCCCcccCCCceEecCCC-eEEEecCCeE
Confidence 789999999644 777777888999996554222111111111 112234567787654 4666665543
No 312
>KOG1409 consensus Uncharacterized conserved protein, contains WD40 repeats and FYVE domains [Function unknown]
Probab=98.00 E-value=0.00021 Score=62.84 Aligned_cols=155 Identities=18% Similarity=0.147 Sum_probs=104.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCC----CCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPT----TSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVL 144 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~----~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~ 144 (359)
+++++.++++...|++|-.+|+|.-+.+. ....+.....|...|..+-|+-....+++.+.|..+.---...+.-+
T Consensus 70 ~~~~~~y~~e~~~L~vg~~ngtvtefs~sedfnkm~~~r~~~~h~~~v~~~if~~~~e~V~s~~~dk~~~~hc~e~~~~l 149 (404)
T KOG1409|consen 70 PCSAMEYVSESRRLYVGQDNGTVTEFALSEDFNKMTFLKDYLAHQARVSAIVFSLTHEWVLSTGKDKQFAWHCTESGNRL 149 (404)
T ss_pred CceEeeeeccceEEEEEEecceEEEEEhhhhhhhcchhhhhhhhhcceeeEEecCCceeEEEeccccceEEEeeccCCcc
Confidence 79999999999999999999999988754 34556677799999999999988889999999887654444444444
Q ss_pred Eee--cCCceeEEEcCCCcEEEEcCCcEEEEcCC-CCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 145 QTL--TGHAKTLDFSQKGLLAVGTGSFAQILGDF-SGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 145 ~~~--~~~v~~~~~s~~gl~~~~~d~~i~v~d~~-~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
..+ ....+++.+.-.--+.+...|.|.+..+. +.-..+..+.+|. ..+.+++|.|....|.+|..|..+.+|.
T Consensus 150 g~Y~~~~~~t~~~~d~~~~fvGd~~gqvt~lr~~~~~~~~i~~~~~h~----~~~~~l~Wd~~~~~LfSg~~d~~vi~wd 225 (404)
T KOG1409|consen 150 GGYNFETPASALQFDALYAFVGDHSGQITMLKLEQNGCQLITTFNGHT----GEVTCLKWDPGQRLLFSGASDHSVIMWD 225 (404)
T ss_pred cceEeeccCCCCceeeEEEEecccccceEEEEEeecCCceEEEEcCcc----cceEEEEEcCCCcEEEeccccCceEEEe
Confidence 333 11222222211101122233444433321 1223344445554 4899999999999999999999988876
Q ss_pred cCCCCC
Q 040274 222 PRSSEP 227 (359)
Q Consensus 222 ~gs~~~ 227 (359)
-|...+
T Consensus 226 igg~~g 231 (404)
T KOG1409|consen 226 IGGRKG 231 (404)
T ss_pred ccCCcc
Confidence 665443
No 313
>KOG1920 consensus IkappaB kinase complex, IKAP component [Transcription]
Probab=97.97 E-value=0.00067 Score=68.85 Aligned_cols=147 Identities=14% Similarity=0.200 Sum_probs=92.8
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeC----CCCcce-------------------EEeecCCC---------------
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKP----TTSALL-------------------IKMLYHQG--------------- 110 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~----~~~~~~-------------------~~~~~h~~--------------- 110 (359)
.|.+++||||..+++..+.++++.+-+- -..+++ ..|.|..+
T Consensus 111 GI~aaswS~Dee~l~liT~~~tll~mT~~f~~i~E~~L~~d~~~~sk~v~VGwGrkeTqfrgs~gr~~~~~~~~~ek~~~ 190 (1265)
T KOG1920|consen 111 GISAASWSPDEELLALITGRQTLLFMTKDFEPIAEKPLDADDERKSKFVNVGWGRKETQFRGSEGRQAARQKIEKEKALE 190 (1265)
T ss_pred ceEEEeecCCCcEEEEEeCCcEEEEEeccccchhccccccccccccccceecccccceeeecchhhhccccccccccccc
Confidence 8999999999999999888888766542 111111 12221111
Q ss_pred ------CeEEEEEecCCCEEEEec----CC-CeEEEEEcCCCeeeEee----cCCceeEEEcCCC-cEEEE----cCCcE
Q 040274 111 ------PVSALAFHPNGHLMATTG----KE-CKIKIWDLRKYEVLQTL----TGHAKTLDFSQKG-LLAVG----TGSFA 170 (359)
Q Consensus 111 ------~v~~l~~~p~g~~l~s~~----~d-~~i~vwd~~~~~~~~~~----~~~v~~~~~s~~g-l~~~~----~d~~i 170 (359)
.=++++|--||.++|+.. .+ ..|+|||.. |. +... .+--.+++|-|.| ++++- +++.|
T Consensus 191 ~~~~~~~~~~IsWRgDg~~fAVs~~~~~~~~RkirV~drE-g~-Lns~se~~~~l~~~LsWkPsgs~iA~iq~~~sd~~I 268 (1265)
T KOG1920|consen 191 QIEQDDHKTSISWRGDGEYFAVSFVESETGTRKIRVYDRE-GA-LNSTSEPVEGLQHSLSWKPSGSLIAAIQCKTSDSDI 268 (1265)
T ss_pred chhhccCCceEEEccCCcEEEEEEEeccCCceeEEEeccc-ch-hhcccCcccccccceeecCCCCeEeeeeecCCCCcE
Confidence 124589999999998843 23 789999977 43 3333 2234789999999 44433 35679
Q ss_pred EEEcCCCCCccc---cccccccCCCCcceeEEEEccCCCEEEE---EeCCCeEEEEEc
Q 040274 171 QILGDFSGSHNY---SRYMGNSMVKGYQIGKVSFRPYEDVLGI---GHSMGWSGILVP 222 (359)
Q Consensus 171 ~v~d~~~~~~~~---~~~~~~~~~~~~~v~~~~~sp~~~~l~~---g~~dg~~~i~~~ 222 (359)
.+|. +++-..- ...+... ..|..++|+.+++.|++ ......+.+|..
T Consensus 269 vffE-rNGL~hg~f~l~~p~de----~~ve~L~Wns~sdiLAv~~~~~e~~~v~lwt~ 321 (1265)
T KOG1920|consen 269 VFFE-RNGLRHGEFVLPFPLDE----KEVEELAWNSNSDILAVVTSNLENSLVQLWTT 321 (1265)
T ss_pred EEEe-cCCccccccccCCcccc----cchheeeecCCCCceeeeecccccceEEEEEe
Confidence 9997 5542211 1122221 14899999999999998 334444666543
No 314
>PF07433 DUF1513: Protein of unknown function (DUF1513); InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=97.95 E-value=0.0014 Score=58.06 Aligned_cols=144 Identities=20% Similarity=0.235 Sum_probs=95.7
Q ss_pred eeEEEEcC-CCCEEEEEeCCCe-EEEEeCCCCcceEEeecCCCCe--EEEEEecCCCEEEEecC-----CCeEEEEEcC-
Q 040274 70 TDLMRVNP-FNGVVSLGHSGGT-VTMWKPTTSALLIKMLYHQGPV--SALAFHPNGHLMATTGK-----ECKIKIWDLR- 139 (359)
Q Consensus 70 v~~l~~sp-~~~~l~tg~~dg~-v~lwd~~~~~~~~~~~~h~~~v--~~l~~~p~g~~l~s~~~-----d~~i~vwd~~- 139 (359)
.+.++.+| ....++.+-.-|+ ..+||+.+++....+....+.- -.-.|+|||++|++.-. .|.|-|||..
T Consensus 7 gH~~a~~p~~~~avafaRRPG~~~~v~D~~~g~~~~~~~a~~gRHFyGHg~fs~dG~~LytTEnd~~~g~G~IgVyd~~~ 86 (305)
T PF07433_consen 7 GHGVAAHPTRPEAVAFARRPGTFALVFDCRTGQLLQRLWAPPGRHFYGHGVFSPDGRLLYTTENDYETGRGVIGVYDAAR 86 (305)
T ss_pred ccceeeCCCCCeEEEEEeCCCcEEEEEEcCCCceeeEEcCCCCCEEecCEEEcCCCCEEEEeccccCCCcEEEEEEECcC
Confidence 46788889 5566777777774 7789999998777665433322 23679999999999754 4789999999
Q ss_pred CCeeeEeecCC---ceeEEEcCCC-cEEEEcCC-------------------cEEEEcCCCCCcccccccc-ccCCCCcc
Q 040274 140 KYEVLQTLTGH---AKTLDFSQKG-LLAVGTGS-------------------FAQILGDFSGSHNYSRYMG-NSMVKGYQ 195 (359)
Q Consensus 140 ~~~~~~~~~~~---v~~~~~s~~g-l~~~~~d~-------------------~i~v~d~~~~~~~~~~~~~-~~~~~~~~ 195 (359)
+...+.+++.+ ...+.+.||| .+++..+| ++.+.|..++ ..+....- ... +...
T Consensus 87 ~~~ri~E~~s~GIGPHel~l~pDG~tLvVANGGI~Thpd~GR~kLNl~tM~psL~~ld~~sG-~ll~q~~Lp~~~-~~lS 164 (305)
T PF07433_consen 87 GYRRIGEFPSHGIGPHELLLMPDGETLVVANGGIETHPDSGRAKLNLDTMQPSLVYLDARSG-ALLEQVELPPDL-HQLS 164 (305)
T ss_pred CcEEEeEecCCCcChhhEEEcCCCCEEEEEcCCCccCcccCceecChhhcCCceEEEecCCC-ceeeeeecCccc-cccc
Confidence 67778888443 4778899999 55444433 3444442222 33322111 001 2336
Q ss_pred eeEEEEccCCCEEEEEeCCC
Q 040274 196 IGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 196 v~~~~~sp~~~~l~~g~~dg 215 (359)
|..+++.++|..++..-..|
T Consensus 165 iRHLa~~~~G~V~~a~Q~qg 184 (305)
T PF07433_consen 165 IRHLAVDGDGTVAFAMQYQG 184 (305)
T ss_pred eeeEEecCCCcEEEEEecCC
Confidence 99999999998887766665
No 315
>PRK02888 nitrous-oxide reductase; Validated
Probab=97.94 E-value=0.00052 Score=66.23 Aligned_cols=160 Identities=11% Similarity=-0.016 Sum_probs=98.8
Q ss_pred eEEEECCCCCEEEEecc------ce---------eEEEE--------cCCCCEEEEEeCCCeEEEEeCCC----C-cceE
Q 040274 52 ILWILPSSGRYMAVAGR------RT---------DLMRV--------NPFNGVVSLGHSGGTVTMWKPTT----S-ALLI 103 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------~v---------~~l~~--------sp~~~~l~tg~~dg~v~lwd~~~----~-~~~~ 103 (359)
..++++|||.++.+.+. .+ ..+.| .++|++... .++.|.+.|..+ + ..+.
T Consensus 238 d~v~~spdGk~afvTsyNsE~G~tl~em~a~e~d~~vvfni~~iea~vkdGK~~~V--~gn~V~VID~~t~~~~~~~v~~ 315 (635)
T PRK02888 238 DNVDTDYDGKYAFSTCYNSEEGVTLAEMMAAERDWVVVFNIARIEEAVKAGKFKTI--GGSKVPVVDGRKAANAGSALTR 315 (635)
T ss_pred ccceECCCCCEEEEeccCcccCcceeeeccccCceEEEEchHHHHHhhhCCCEEEE--CCCEEEEEECCccccCCcceEE
Confidence 46778899999987752 11 22233 335555554 256899999988 3 3344
Q ss_pred EeecCCCCeEEEEEecCCCEEEEec-CCCeEEEEEcCCCee------------eEee--cCCceeEEEcCCC--cEEEEc
Q 040274 104 KMLYHQGPVSALAFHPNGHLMATTG-KECKIKIWDLRKYEV------------LQTL--TGHAKTLDFSQKG--LLAVGT 166 (359)
Q Consensus 104 ~~~~h~~~v~~l~~~p~g~~l~s~~-~d~~i~vwd~~~~~~------------~~~~--~~~v~~~~~s~~g--l~~~~~ 166 (359)
.+. -....+.+.++|||+++++++ .+.+|.|.|+.+.+. +... .......+|+++| +.+.--
T Consensus 316 yIP-VGKsPHGV~vSPDGkylyVanklS~tVSVIDv~k~k~~~~~~~~~~~~vvaevevGlGPLHTaFDg~G~aytslf~ 394 (635)
T PRK02888 316 YVP-VPKNPHGVNTSPDGKYFIANGKLSPTVTVIDVRKLDDLFDGKIKPRDAVVAEPELGLGPLHTAFDGRGNAYTTLFL 394 (635)
T ss_pred EEE-CCCCccceEECCCCCEEEEeCCCCCcEEEEEChhhhhhhhccCCccceEEEeeccCCCcceEEECCCCCEEEeEee
Confidence 443 355568999999999977665 589999999987542 2222 1123567899998 666667
Q ss_pred CCcEEEEcCCCC-----C----ccccccccccCCCCc--ceeEEEEccCCCEEEEEeCCC
Q 040274 167 GSFAQILGDFSG-----S----HNYSRYMGNSMVKGY--QIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 167 d~~i~v~d~~~~-----~----~~~~~~~~~~~~~~~--~v~~~~~sp~~~~l~~g~~dg 215 (359)
|..|..||+... + ..+..+.-|-. ++. ....=.-.|||+||++...-.
T Consensus 395 dsqv~kwn~~~a~~~~~g~~~~~v~~k~dV~y~-pgh~~~~~g~t~~~dgk~l~~~nk~s 453 (635)
T PRK02888 395 DSQIVKWNIEAAIRAYKGEKVDPIVQKLDVHYQ-PGHNHASMGETKEADGKWLVSLNKFS 453 (635)
T ss_pred cceeEEEehHHHHHHhccccCCcceecccCCCc-cceeeecCCCcCCCCCCEEEEccccc
Confidence 899999996541 1 12222222211 111 111223368999998876543
No 316
>KOG1645 consensus RING-finger-containing E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=97.93 E-value=0.00012 Score=65.68 Aligned_cols=73 Identities=15% Similarity=0.284 Sum_probs=63.3
Q ss_pred ceeEEEEcCCCC-EEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCC-CEEEEecCCCeEEEEEcCCCe
Q 040274 69 RTDLMRVNPFNG-VVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNG-HLMATTGKECKIKIWDLRKYE 142 (359)
Q Consensus 69 ~v~~l~~sp~~~-~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g-~~l~s~~~d~~i~vwd~~~~~ 142 (359)
.|..|+|||.+. ++..++.+..|.|.|+.+...+..+..| ..+++++|+-|. ++++.|...|.|.+||++..+
T Consensus 195 ~IrdlafSp~~~GLl~~asl~nkiki~dlet~~~vssy~a~-~~~wSC~wDlde~h~IYaGl~nG~VlvyD~R~~~ 269 (463)
T KOG1645|consen 195 FIRDLAFSPFNEGLLGLASLGNKIKIMDLETSCVVSSYIAY-NQIWSCCWDLDERHVIYAGLQNGMVLVYDMRQPE 269 (463)
T ss_pred hhhhhccCccccceeeeeccCceEEEEecccceeeeheecc-CCceeeeeccCCcceeEEeccCceEEEEEccCCC
Confidence 799999999665 7889999999999999999888888887 789999998865 457777789999999999643
No 317
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=97.87 E-value=0.00058 Score=59.16 Aligned_cols=138 Identities=18% Similarity=0.149 Sum_probs=86.6
Q ss_pred CCCeEEEEeCCCCcceEEeecCCCCeEEEE--EecCCCEEEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCC-c
Q 040274 87 SGGTVTMWKPTTSALLIKMLYHQGPVSALA--FHPNGHLMATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG-L 161 (359)
Q Consensus 87 ~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~--~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g-l 161 (359)
.+|+|..||+.+|+.+....... ...... ..+++..+++++.++.|+.||..+|+.+..+ .+.+.......++ +
T Consensus 1 ~~g~l~~~d~~tG~~~W~~~~~~-~~~~~~~~~~~~~~~v~~~~~~~~l~~~d~~tG~~~W~~~~~~~~~~~~~~~~~~v 79 (238)
T PF13360_consen 1 DDGTLSALDPRTGKELWSYDLGP-GIGGPVATAVPDGGRVYVASGDGNLYALDAKTGKVLWRFDLPGPISGAPVVDGGRV 79 (238)
T ss_dssp -TSEEEEEETTTTEEEEEEECSS-SCSSEEETEEEETTEEEEEETTSEEEEEETTTSEEEEEEECSSCGGSGEEEETTEE
T ss_pred CCCEEEEEECCCCCEEEEEECCC-CCCCccceEEEeCCEEEEEcCCCEEEEEECCCCCEEEEeeccccccceeeeccccc
Confidence 36899999999999888875411 111122 2335667778789999999999999988777 3333222233344 7
Q ss_pred EEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCC
Q 040274 162 LAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSE 226 (359)
Q Consensus 162 ~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~ 226 (359)
+.++.++.|..+|..++............ ............++..++++..++.+..+...+|.
T Consensus 80 ~v~~~~~~l~~~d~~tG~~~W~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~g~l~~~d~~tG~ 143 (238)
T PF13360_consen 80 YVGTSDGSLYALDAKTGKVLWSIYLTSSP-PAGVRSSSSPAVDGDRLYVGTSSGKLVALDPKTGK 143 (238)
T ss_dssp EEEETTSEEEEEETTTSCEEEEEEE-SSC-TCSTB--SEEEEETTEEEEEETCSEEEEEETTTTE
T ss_pred ccccceeeeEecccCCcceeeeecccccc-ccccccccCceEecCEEEEEeccCcEEEEecCCCc
Confidence 77778889999996666433331222110 00012223333348888888889988888866554
No 318
>PF04053 Coatomer_WDAD: Coatomer WD associated region ; InterPro: IPR006692 Proteins synthesised on the ribosome and processed in the endoplasmic reticulum are transported from the Golgi apparatus to the trans-Golgi network (TGN), and from there via small carrier vesicles to their final destination compartment. This traffic is bidirectional, to ensure that proteins required to form vesicles are recycled. Vesicles have specific coat proteins (such as clathrin or coatomer) that are important for cargo selection and direction of transfer []. While clathrin mediates endocytic protein transport, and transport from ER to Golgi, coatomers primarily mediate intra-Golgi transport, as well as the reverse Golgi to ER transport of dilysine-tagged proteins []. For example, the coatomer COP1 (coat protein complex 1) is responsible for reverse transport of recycled proteins from Golgi and pre-Golgi compartments back to the ER, while COPII buds vesicles from the ER to the Golgi []. Coatomers reversibly associate with Golgi (non-clathrin-coated) vesicles to mediate protein transport and for budding from Golgi membranes []. Activated small guanine triphosphatases (GTPases) attract coat proteins to specific membrane export sites, thereby linking coatomers to export cargos. As coat proteins polymerise, vesicles are formed and budded from membrane-bound organelles. Coatomer complexes also influence Golgi structural integrity, as well as the processing, activity, and endocytic recycling of LDL receptors. In mammals, coatomer complexes can only be recruited by membranes associated to ADP-ribosylation factors (ARFs), which are small GTP-binding proteins. Coatomer complexes are hetero-oligomers composed of at least an alpha, beta, beta', gamma, delta, epsilon and zeta subunits. This entry represents the WD-associated region found in coatomer subunits alpha, beta and beta' subunits. The alpha-subunit (RET1P) of the coatomer complex in Saccharomyces cerevisiae (Baker's yeast), participates in membrane transport between the endoplasmic reticulum and Golgi apparatus. The protein contains six WD-40 repeat motifs in its N-terminal region []. More information about these proteins can be found at Protein of the Month: Clathrin [].; GO: 0005198 structural molecule activity, 0006886 intracellular protein transport, 0016192 vesicle-mediated transport, 0030117 membrane coat; PDB: 3MKQ_B.
Probab=97.86 E-value=0.0007 Score=64.02 Aligned_cols=132 Identities=15% Similarity=0.128 Sum_probs=74.8
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
....|.+||+|.++++ +.||.-.||......... .+.-..++|.+.+ .+|+-...++|.++.--.......+.
T Consensus 34 ~p~~ls~npngr~v~V-~g~geY~iyt~~~~r~k~-----~G~g~~~vw~~~n-~yAv~~~~~~I~I~kn~~~~~~k~i~ 106 (443)
T PF04053_consen 34 YPQSLSHNPNGRFVLV-CGDGEYEIYTALAWRNKA-----FGSGLSFVWSSRN-RYAVLESSSTIKIYKNFKNEVVKSIK 106 (443)
T ss_dssp --SEEEE-TTSSEEEE-EETTEEEEEETTTTEEEE-----EEE-SEEEE-TSS-EEEEE-TTS-EEEEETTEE-TT----
T ss_pred CCeeEEECCCCCEEEE-EcCCEEEEEEccCCcccc-----cCceeEEEEecCc-cEEEEECCCeEEEEEcCccccceEEc
Confidence 6789999999999888 457787788743332211 2334678898855 46666668889997332333333442
Q ss_pred C--CceeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeE
Q 040274 149 G--HAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWS 217 (359)
Q Consensus 149 ~--~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~ 217 (359)
- .+..+-. | ++....++.|.+||+.+. ..+..+... .|..+.|+++|.+++..+.+.+.
T Consensus 107 ~~~~~~~If~---G~LL~~~~~~~i~~yDw~~~-~~i~~i~v~------~vk~V~Ws~~g~~val~t~~~i~ 168 (443)
T PF04053_consen 107 LPFSVEKIFG---GNLLGVKSSDFICFYDWETG-KLIRRIDVS------AVKYVIWSDDGELVALVTKDSIY 168 (443)
T ss_dssp -SS-EEEEE----SSSEEEEETTEEEEE-TTT---EEEEESS-------E-EEEEE-TTSSEEEEE-S-SEE
T ss_pred CCcccceEEc---CcEEEEECCCCEEEEEhhHc-ceeeEEecC------CCcEEEEECCCCEEEEEeCCeEE
Confidence 2 2333332 7 777777778999997554 444444332 58999999999999999887653
No 319
>smart00320 WD40 WD40 repeats. Note that these repeats are permuted with respect to the structural repeats (blades) of the beta propeller domain.
Probab=97.83 E-value=5.7e-05 Score=44.01 Aligned_cols=38 Identities=39% Similarity=0.831 Sum_probs=33.9
Q ss_pred cceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEE
Q 040274 100 ALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWD 137 (359)
Q Consensus 100 ~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd 137 (359)
.++..+..|...|+++.|++++.++++++.|+.+++||
T Consensus 3 ~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~d~~~~~~~ 40 (40)
T smart00320 3 ELLKTLKGHTGPVTSVAFSPDGKYLASASDDGTIKLWD 40 (40)
T ss_pred EEEEEEEecCCceeEEEECCCCCEEEEecCCCeEEEcC
Confidence 45666778899999999999999999999999999996
No 320
>PF08553 VID27: VID27 cytoplasmic protein; InterPro: IPR013863 This entry represents fungal and plant proteins and contains many hypothetical proteins. Vid27p is a cytoplasmic protein of unknown function, possibly regulates import of fructose-1,6-bisphosphatase into Vacuolar Import and Degradation (Vid) vesicles and is not essential for proteasome-dependent degradation of fructose-1,6-bisphosphatase (FBPase) [, ].
Probab=97.83 E-value=0.0005 Score=68.63 Aligned_cols=126 Identities=8% Similarity=-0.021 Sum_probs=88.7
Q ss_pred CCCeEEEEeCCCCcceEEeecCCCC-eEEEEEec-----CCCEEEEecCCCeEEEEEcCCCe--eeE----ee--cCCce
Q 040274 87 SGGTVTMWKPTTSALLIKMLYHQGP-VSALAFHP-----NGHLMATTGKECKIKIWDLRKYE--VLQ----TL--TGHAK 152 (359)
Q Consensus 87 ~dg~v~lwd~~~~~~~~~~~~h~~~-v~~l~~~p-----~g~~l~s~~~d~~i~vwd~~~~~--~~~----~~--~~~v~ 152 (359)
....|+-.|+.+|+.+..+..|... |..++-+. +..-.+.|-.+..|..||+|-.. ++. .+ ....+
T Consensus 502 ~~~~ly~mDLe~GKVV~eW~~~~~~~v~~~~p~~K~aqlt~e~tflGls~n~lfriDpR~~~~k~v~~~~k~Y~~~~~Fs 581 (794)
T PF08553_consen 502 NPNKLYKMDLERGKVVEEWKVHDDIPVVDIAPDSKFAQLTNEQTFLGLSDNSLFRIDPRLSGNKLVDSQSKQYSSKNNFS 581 (794)
T ss_pred CCCceEEEecCCCcEEEEeecCCCcceeEecccccccccCCCceEEEECCCceEEeccCCCCCceeeccccccccCCCce
Confidence 4567889999999999998877654 55544221 12335566778889999999632 332 11 22357
Q ss_pred eEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeE
Q 040274 153 TLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWS 217 (359)
Q Consensus 153 ~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~ 217 (359)
|++-+.+| ++.|+.+|.|++|| ..+......+++. +.+|.+|..+.||+||+..+..-.+
T Consensus 582 ~~aTt~~G~iavgs~~G~IRLyd-~~g~~AKT~lp~l----G~pI~~iDvt~DGkwilaTc~tyLl 642 (794)
T PF08553_consen 582 CFATTEDGYIAVGSNKGDIRLYD-RLGKRAKTALPGL----GDPIIGIDVTADGKWILATCKTYLL 642 (794)
T ss_pred EEEecCCceEEEEeCCCcEEeec-ccchhhhhcCCCC----CCCeeEEEecCCCcEEEEeecceEE
Confidence 88889999 88888999999999 4443333344443 4599999999999999887766543
No 321
>PF15492 Nbas_N: Neuroblastoma-amplified sequence, N terminal
Probab=97.80 E-value=0.0025 Score=55.07 Aligned_cols=138 Identities=14% Similarity=0.170 Sum_probs=87.0
Q ss_pred EEEcCCCCEEEEEeCCCeEEEEeCCCC--cceEEeecCC---CCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee
Q 040274 73 MRVNPFNGVVSLGHSGGTVTMWKPTTS--ALLIKMLYHQ---GPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL 147 (359)
Q Consensus 73 l~~sp~~~~l~tg~~dg~v~lwd~~~~--~~~~~~~~h~---~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~ 147 (359)
++.+++|++||.. .|..|.|-..+.. .++.+...+. ..=.-++|+||+.+||.+...|+|++||+-. ..+..+
T Consensus 3 ~~~~~~Gk~lAi~-qd~~iEiRsa~Ddf~si~~kcqVpkD~~PQWRkl~WSpD~tlLa~a~S~G~i~vfdl~g-~~lf~I 80 (282)
T PF15492_consen 3 LALSSDGKLLAIL-QDQCIEIRSAKDDFSSIIGKCQVPKDPNPQWRKLAWSPDCTLLAYAESTGTIRVFDLMG-SELFVI 80 (282)
T ss_pred eeecCCCcEEEEE-eccEEEEEeccCCchheeEEEecCCCCCchheEEEECCCCcEEEEEcCCCeEEEEeccc-ceeEEc
Confidence 5667788777665 6777877765543 2333333222 2346799999999999999999999999874 333444
Q ss_pred c----------CCceeEEEcCC------C--cEEEEcCCcEEEEcCCCC----Ccccc--ccccccCCCCcceeEEEEcc
Q 040274 148 T----------GHAKTLDFSQK------G--LLAVGTGSFAQILGDFSG----SHNYS--RYMGNSMVKGYQIGKVSFRP 203 (359)
Q Consensus 148 ~----------~~v~~~~~s~~------g--l~~~~~d~~i~v~d~~~~----~~~~~--~~~~~~~~~~~~v~~~~~sp 203 (359)
+ ..|..+.|.+- . +++....|.++-|-+..+ ..... .+..| ....|.++.|+|
T Consensus 81 ~p~~~~~~d~~~Aiagl~Fl~~~~s~~ws~ELlvi~Y~G~L~Sy~vs~gt~q~y~e~hsfsf~~~---yp~Gi~~~vy~p 157 (282)
T PF15492_consen 81 PPAMSFPGDLSDAIAGLIFLEYKKSAQWSYELLVINYRGQLRSYLVSVGTNQGYQENHSFSFSSH---YPHGINSAVYHP 157 (282)
T ss_pred CcccccCCccccceeeeEeeccccccccceeEEEEeccceeeeEEEEcccCCcceeeEEEEeccc---CCCceeEEEEcC
Confidence 1 22445555331 1 777888887776654221 11111 11122 233699999999
Q ss_pred CCCEEEEEeCCC
Q 040274 204 YEDVLGIGHSMG 215 (359)
Q Consensus 204 ~~~~l~~g~~dg 215 (359)
..++|++|+...
T Consensus 158 ~h~LLlVgG~~~ 169 (282)
T PF15492_consen 158 KHRLLLVGGCEQ 169 (282)
T ss_pred CCCEEEEeccCC
Confidence 999888777543
No 322
>KOG1920 consensus IkappaB kinase complex, IKAP component [Transcription]
Probab=97.80 E-value=0.0017 Score=66.00 Aligned_cols=139 Identities=14% Similarity=0.137 Sum_probs=93.8
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEc----CCCeee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDL----RKYEVL 144 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~----~~~~~~ 144 (359)
.|.++.|.-+...|+.+..+|.|.+-|+.+.... ..-.-...|.+++|+||+..++..+.++++.+.+- -.-+++
T Consensus 70 ~i~s~~fl~d~~~i~v~~~~G~iilvd~et~~~e-ivg~vd~GI~aaswS~Dee~l~liT~~~tll~mT~~f~~i~E~~L 148 (1265)
T KOG1920|consen 70 EIVSVQFLADTNSICVITALGDIILVDPETLELE-IVGNVDNGISAASWSPDEELLALITGRQTLLFMTKDFEPIAEKPL 148 (1265)
T ss_pred ceEEEEEecccceEEEEecCCcEEEEccccccee-eeeeccCceEEEeecCCCcEEEEEeCCcEEEEEeccccchhcccc
Confidence 6888899888888999999999999998876432 22223567999999999999999988888777542 111111
Q ss_pred -------------------Eeec------------------------CCceeEEEcCCC-cEEEE-----cC-CcEEEEc
Q 040274 145 -------------------QTLT------------------------GHAKTLDFSQKG-LLAVG-----TG-SFAQILG 174 (359)
Q Consensus 145 -------------------~~~~------------------------~~v~~~~~s~~g-l~~~~-----~d-~~i~v~d 174 (359)
..|. ++-++|+|-.|| +++++ .+ ..|+|||
T Consensus 149 ~~d~~~~sk~v~VGwGrkeTqfrgs~gr~~~~~~~~~ek~~~~~~~~~~~~~IsWRgDg~~fAVs~~~~~~~~RkirV~d 228 (1265)
T KOG1920|consen 149 DADDERKSKFVNVGWGRKETQFRGSEGRQAARQKIEKEKALEQIEQDDHKTSISWRGDGEYFAVSFVESETGTRKIRVYD 228 (1265)
T ss_pred ccccccccccceecccccceeeecchhhhcccccccccccccchhhccCCceEEEccCCcEEEEEEEeccCCceeEEEec
Confidence 1111 122569999999 77764 35 7899999
Q ss_pred CCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 175 DFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
+.+ .....-... ...-.+++|-|.|..+++-..+
T Consensus 229 -rEg-~Lns~se~~----~~l~~~LsWkPsgs~iA~iq~~ 262 (1265)
T KOG1920|consen 229 -REG-ALNSTSEPV----EGLQHSLSWKPSGSLIAAIQCK 262 (1265)
T ss_pred -ccc-hhhcccCcc----cccccceeecCCCCeEeeeeec
Confidence 443 221111111 1245679999999998875543
No 323
>KOG0882 consensus Cyclophilin-related peptidyl-prolyl cis-trans isomerase [Posttranslational modification, protein turnover, chaperones]
Probab=97.80 E-value=7.9e-05 Score=67.67 Aligned_cols=142 Identities=15% Similarity=0.230 Sum_probs=104.1
Q ss_pred CCCEEEEEeCCCeEEEEeCCC--C-cceEEeecCCCCeEEEEEecCCCEEEEecC-CCeEEEEEcCCCeeeEee-----c
Q 040274 78 FNGVVSLGHSGGTVTMWKPTT--S-ALLIKMLYHQGPVSALAFHPNGHLMATTGK-ECKIKIWDLRKYEVLQTL-----T 148 (359)
Q Consensus 78 ~~~~l~tg~~dg~v~lwd~~~--~-~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~-d~~i~vwd~~~~~~~~~~-----~ 148 (359)
-..++.+++.||.+..|-... + +.+..+.+|.+.|.+++.+-+|.++.|.+. |..++++|+.+...+..+ +
T Consensus 19 ka~fiiqASlDGh~KFWkKs~isGvEfVKhFraHL~~I~sl~~S~dg~L~~Sv~d~Dhs~KvfDvEn~DminmiKL~~lP 98 (558)
T KOG0882|consen 19 KAKFIIQASLDGHKKFWKKSRISGVEFVKHFRAHLGVILSLAVSYDGWLFRSVEDPDHSVKVFDVENFDMINMIKLVDLP 98 (558)
T ss_pred hhheEEeeecchhhhhcCCCCccceeehhhhHHHHHHHHhhhccccceeEeeccCcccceeEEEeeccchhhhcccccCC
Confidence 456899999999999998653 2 345567789999999999999999999777 999999999876554333 3
Q ss_pred CCceeEEEcCCC---cEEEE--cCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 149 GHAKTLDFSQKG---LLAVG--TGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 149 ~~v~~~~~s~~g---l~~~~--~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
+.+ ++..++.. +++++ .++.+.|+|-.........+... |.++|.++.++|.++.+++....|.+.-|..-
T Consensus 99 g~a-~wv~skGd~~s~IAVs~~~sg~i~VvD~~~d~~q~~~fkkl---H~sPV~~i~y~qa~Ds~vSiD~~gmVEyWs~e 174 (558)
T KOG0882|consen 99 GFA-EWVTSKGDKISLIAVSLFKSGKIFVVDGFGDFCQDGYFKKL---HFSPVKKIRYNQAGDSAVSIDISGMVEYWSAE 174 (558)
T ss_pred Cce-EEecCCCCeeeeEEeecccCCCcEEECCcCCcCccceeccc---ccCceEEEEeeccccceeeccccceeEeecCC
Confidence 332 22234432 55655 36899999954443233333222 56699999999999999999999988888754
No 324
>KOG3617 consensus WD40 and TPR repeat-containing protein [General function prediction only]
Probab=97.80 E-value=3.5e-05 Score=74.97 Aligned_cols=103 Identities=16% Similarity=0.142 Sum_probs=76.4
Q ss_pred EEEEEecCCCEEEEecC----CCeEEEEEcCCCeeeEee--cCCceeEEEcCCC-cEEEEcC-CcEEEEcCCCCCccccc
Q 040274 113 SALAFHPNGHLMATTGK----ECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG-LLAVGTG-SFAQILGDFSGSHNYSR 184 (359)
Q Consensus 113 ~~l~~~p~g~~l~s~~~----d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g-l~~~~~d-~~i~v~d~~~~~~~~~~ 184 (359)
+-.+|+|...+|++++- .|.|.|| ..+|++-... +-+++++||+|.. +++.++. |.+.+|...+. .....
T Consensus 19 ti~SWHPsePlfAVA~fS~er~GSVtIf-adtGEPqr~Vt~P~hatSLCWHpe~~vLa~gwe~g~~~v~~~~~~-e~htv 96 (1416)
T KOG3617|consen 19 TISSWHPSEPLFAVASFSPERGGSVTIF-ADTGEPQRDVTYPVHATSLCWHPEEFVLAQGWEMGVSDVQKTNTT-ETHTV 96 (1416)
T ss_pred cccccCCCCceeEEEEecCCCCceEEEE-ecCCCCCcccccceehhhhccChHHHHHhhccccceeEEEecCCc-eeeee
Confidence 33578998888887763 4778887 4667765544 6678999999998 6666654 88999984333 33333
Q ss_pred cccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 185 YMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 185 ~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
...|. .+|..+.|||+|..|+++..-|.+.+|-
T Consensus 97 ~~th~----a~i~~l~wS~~G~~l~t~d~~g~v~lwr 129 (1416)
T KOG3617|consen 97 VETHP----APIQGLDWSHDGTVLMTLDNPGSVHLWR 129 (1416)
T ss_pred ccCCC----CCceeEEecCCCCeEEEcCCCceeEEEE
Confidence 44444 4899999999999999999999888773
No 325
>COG0823 TolB Periplasmic component of the Tol biopolymer transport system [Intracellular trafficking and secretion]
Probab=97.76 E-value=0.00047 Score=64.93 Aligned_cols=138 Identities=15% Similarity=0.129 Sum_probs=87.3
Q ss_pred ceeEEEEcCCCCEEEEEe---CC-CeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEec-CCCe--EEEEEcCCC
Q 040274 69 RTDLMRVNPFNGVVSLGH---SG-GTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTG-KECK--IKIWDLRKY 141 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~---~d-g~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~-~d~~--i~vwd~~~~ 141 (359)
.+..-+|+|++..++..+ .. ..+.++++.++.....+. ..+.-...+|+|||+.|+.+. .||. |+++|+...
T Consensus 194 ~~~~p~ws~~~~~~~y~~f~~~~~~~i~~~~l~~g~~~~i~~-~~g~~~~P~fspDG~~l~f~~~rdg~~~iy~~dl~~~ 272 (425)
T COG0823 194 LILTPAWSPDGKKLAYVSFELGGCPRIYYLDLNTGKRPVILN-FNGNNGAPAFSPDGSKLAFSSSRDGSPDIYLMDLDGK 272 (425)
T ss_pred ceeccccCcCCCceEEEEEecCCCceEEEEeccCCccceeec-cCCccCCccCCCCCCEEEEEECCCCCccEEEEcCCCC
Confidence 567778999888765543 22 469999999886554443 234445689999999876654 4554 777788876
Q ss_pred eeeE--eecCCceeEEEcCCC--cEEEE-cCC--cEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeC
Q 040274 142 EVLQ--TLTGHAKTLDFSQKG--LLAVG-TGS--FAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHS 213 (359)
Q Consensus 142 ~~~~--~~~~~v~~~~~s~~g--l~~~~-~d~--~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~ 213 (359)
.... ...+.-+.-.|+||| ++.++ ..| .|.+++.... ....+..... .-....|+|||++|+..+.
T Consensus 273 ~~~~Lt~~~gi~~~Ps~spdG~~ivf~Sdr~G~p~I~~~~~~g~--~~~riT~~~~----~~~~p~~SpdG~~i~~~~~ 345 (425)
T COG0823 273 NLPRLTNGFGINTSPSWSPDGSKIVFTSDRGGRPQIYLYDLEGS--QVTRLTFSGG----GNSNPVWSPDGDKIVFESS 345 (425)
T ss_pred cceecccCCccccCccCCCCCCEEEEEeCCCCCcceEEECCCCC--ceeEeeccCC----CCcCccCCCCCCEEEEEec
Confidence 6332 114445678999999 44333 344 5566663322 2233322211 2237889999999988775
No 326
>KOG3621 consensus WD40 repeat-containing protein [General function prediction only]
Probab=97.72 E-value=0.00026 Score=67.82 Aligned_cols=106 Identities=18% Similarity=0.224 Sum_probs=78.7
Q ss_pred EECCCCCEEEEecc------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEE-----e
Q 040274 55 ILPSSGRYMAVAGR------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIK-----M 105 (359)
Q Consensus 55 ~~spdg~~l~~~~~------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~-----~ 105 (359)
+++..+.+|+.|+. .+..+..|++..++|.|+..|.|.++-++.+.+... +
T Consensus 40 c~dst~~~l~~GsS~G~lyl~~R~~~~~~~~~~~~~~~~~~~~~vs~~e~lvAagt~~g~V~v~ql~~~~p~~~~~~t~~ 119 (726)
T KOG3621|consen 40 CVDATEEYLAMGSSAGSVYLYNRHTGEMRKLKNEGATGITCVRSVSSVEYLVAAGTASGRVSVFQLNKELPRDLDYVTPC 119 (726)
T ss_pred EeecCCceEEEecccceEEEEecCchhhhcccccCccceEEEEEecchhHhhhhhcCCceEEeehhhccCCCcceeeccc
Confidence 44566777777765 456677788888999999999999998876433211 1
Q ss_pred e-cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC-------CeeeEeecCCceeEEEcCCC
Q 040274 106 L-YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRK-------YEVLQTLTGHAKTLDFSQKG 160 (359)
Q Consensus 106 ~-~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~-------~~~~~~~~~~v~~~~~s~~g 160 (359)
. .|...|++++|++++..+++|...|.|.+--+.+ -+.+.+..+.|..+++...-
T Consensus 120 d~~~~~rVTal~Ws~~~~k~ysGD~~Gkv~~~~L~s~~~~~~~~q~il~~ds~IVQlD~~q~~ 182 (726)
T KOG3621|consen 120 DKSHKCRVTALEWSKNGMKLYSGDSQGKVVLTELDSRQAFLSKSQEILSEDSEIVQLDYLQSY 182 (726)
T ss_pred cccCCceEEEEEecccccEEeecCCCceEEEEEechhhhhccccceeeccCcceEEeecccce
Confidence 1 3678899999999999999999999998877765 12333446778778776654
No 327
>PF14783 BBS2_Mid: Ciliary BBSome complex subunit 2, middle region
Probab=97.72 E-value=0.0026 Score=47.35 Aligned_cols=96 Identities=10% Similarity=0.144 Sum_probs=65.0
Q ss_pred eeEEEEcC-CC---CEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeE
Q 040274 70 TDLMRVNP-FN---GVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQ 145 (359)
Q Consensus 70 v~~l~~sp-~~---~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~ 145 (359)
|++|++.. ++ +-|++|+.|..|++|+-. ..+..+.. .+.|++++-... ..|+.+..+|+|-+|+-. ..+.
T Consensus 2 V~al~~~d~d~dg~~eLlvGs~D~~IRvf~~~--e~~~Ei~e-~~~v~~L~~~~~-~~F~Y~l~NGTVGvY~~~--~RlW 75 (111)
T PF14783_consen 2 VTALCLFDFDGDGENELLVGSDDFEIRVFKGD--EIVAEITE-TDKVTSLCSLGG-GRFAYALANGTVGVYDRS--QRLW 75 (111)
T ss_pred eeEEEEEecCCCCcceEEEecCCcEEEEEeCC--cEEEEEec-ccceEEEEEcCC-CEEEEEecCCEEEEEeCc--ceee
Confidence 66777755 33 579999999999999844 45555543 567888877665 579999999999999863 2233
Q ss_pred ee--cCCceeEEE---cCCC---cEEEEcCCcEE
Q 040274 146 TL--TGHAKTLDF---SQKG---LLAVGTGSFAQ 171 (359)
Q Consensus 146 ~~--~~~v~~~~~---s~~g---l~~~~~d~~i~ 171 (359)
.+ ...++++++ ..+| ++++-.+|.|.
T Consensus 76 RiKSK~~~~~~~~~D~~gdG~~eLI~GwsnGkve 109 (111)
T PF14783_consen 76 RIKSKNQVTSMAFYDINGDGVPELIVGWSNGKVE 109 (111)
T ss_pred eeccCCCeEEEEEEcCCCCCceEEEEEecCCeEE
Confidence 33 334555544 3345 77776777664
No 328
>PRK13616 lipoprotein LpqB; Provisional
Probab=97.71 E-value=0.00091 Score=65.68 Aligned_cols=144 Identities=10% Similarity=0.044 Sum_probs=83.5
Q ss_pred ceeEEEEcCCCCEEEEEe------CCC--eEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecC-----------
Q 040274 69 RTDLMRVNPFNGVVSLGH------SGG--TVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGK----------- 129 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~------~dg--~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~----------- 129 (359)
.+...+++|+|..++... .|. .|.+++.. +.....+.+ ...+...|+|+|..+++...
T Consensus 351 ~vsspaiSpdG~~vA~v~~~~~~~~d~~s~Lwv~~~g-g~~~~lt~g--~~~t~PsWspDG~~lw~v~dg~~~~~v~~~~ 427 (591)
T PRK13616 351 NITSAALSRSGRQVAAVVTLGRGAPDPASSLWVGPLG-GVAVQVLEG--HSLTRPSWSLDADAVWVVVDGNTVVRVIRDP 427 (591)
T ss_pred CcccceECCCCCEEEEEEeecCCCCCcceEEEEEeCC-CcceeeecC--CCCCCceECCCCCceEEEecCcceEEEeccC
Confidence 577889999999877665 243 45555542 222222223 23788999999887766642
Q ss_pred -CCeEEEEEcCCCeeeEeecCCceeEEEcCCC-cEEEEcCCcEEEEcC--CCCCccccc---c-ccccCCCCcceeEEEE
Q 040274 130 -ECKIKIWDLRKYEVLQTLTGHAKTLDFSQKG-LLAVGTGSFAQILGD--FSGSHNYSR---Y-MGNSMVKGYQIGKVSF 201 (359)
Q Consensus 130 -d~~i~vwd~~~~~~~~~~~~~v~~~~~s~~g-l~~~~~d~~i~v~d~--~~~~~~~~~---~-~~~~~~~~~~v~~~~~ 201 (359)
.+.+.+.++..+.....+.+.|..+.||||| .++...++.|++--+ ...+. ... . .... .+..+.++.|
T Consensus 428 ~~gql~~~~vd~ge~~~~~~g~Issl~wSpDG~RiA~i~~g~v~Va~Vvr~~~G~-~~l~~~~~l~~~--l~~~~~~l~W 504 (591)
T PRK13616 428 ATGQLARTPVDASAVASRVPGPISELQLSRDGVRAAMIIGGKVYLAVVEQTEDGQ-YALTNPREVGPG--LGDTAVSLDW 504 (591)
T ss_pred CCceEEEEeccCchhhhccCCCcCeEEECCCCCEEEEEECCEEEEEEEEeCCCCc-eeecccEEeecc--cCCccccceE
Confidence 2345555665555433456679999999999 444334677776221 12222 111 0 1111 1223688999
Q ss_pred ccCCCEEEEEeCCCeEEE
Q 040274 202 RPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 202 sp~~~~l~~g~~dg~~~i 219 (359)
.+++.++ ++..++...+
T Consensus 505 ~~~~~L~-V~~~~~~~~v 521 (591)
T PRK13616 505 RTGDSLV-VGRSDPEHPV 521 (591)
T ss_pred ecCCEEE-EEecCCCCce
Confidence 9999855 5554443333
No 329
>KOG2114 consensus Vacuolar assembly/sorting protein PEP5/VPS11 [Intracellular trafficking, secretion, and vesicular transport]
Probab=97.68 E-value=0.0026 Score=62.54 Aligned_cols=156 Identities=12% Similarity=0.057 Sum_probs=97.5
Q ss_pred EECCCCCEEEEecc----------------------c-eeEEEEcCCCCEEEEEeCCC-----eEEEEeCCCC------c
Q 040274 55 ILPSSGRYMAVAGR----------------------R-TDLMRVNPFNGVVSLGHSGG-----TVTMWKPTTS------A 100 (359)
Q Consensus 55 ~~spdg~~l~~~~~----------------------~-v~~l~~sp~~~~l~tg~~dg-----~v~lwd~~~~------~ 100 (359)
+|++++..++.|+. . |..+-...+..+|++.+.|+ .|++|+++.. .
T Consensus 30 c~~s~~~~vvigt~~G~V~~Ln~s~~~~~~fqa~~~siv~~L~~~~~~~~L~sv~Ed~~~np~llkiw~lek~~~n~sP~ 109 (933)
T KOG2114|consen 30 CCSSSTGSVVIGTADGRVVILNSSFQLIRGFQAYEQSIVQFLYILNKQNFLFSVGEDEQGNPVLLKIWDLEKVDKNNSPQ 109 (933)
T ss_pred EEcCCCceEEEeeccccEEEecccceeeehheecchhhhhHhhcccCceEEEEEeecCCCCceEEEEecccccCCCCCcc
Confidence 56777777777765 2 22222222335677766543 5899997632 2
Q ss_pred ceE--Eeec-----CCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC----Ce-eeEee--cCCceeEEEcCCC--cEEE
Q 040274 101 LLI--KMLY-----HQGPVSALAFHPNGHLMATTGKECKIKIWDLRK----YE-VLQTL--TGHAKTLDFSQKG--LLAV 164 (359)
Q Consensus 101 ~~~--~~~~-----h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~----~~-~~~~~--~~~v~~~~~s~~g--l~~~ 164 (359)
++. .+.. ...++.+++++.+-..+|+|-.+|.|..+.-+- +. ..... .++|+.+.+..++ .+.+
T Consensus 110 c~~~~ri~~~~np~~~~p~s~l~Vs~~l~~Iv~Gf~nG~V~~~~GDi~RDrgsr~~~~~~~~~pITgL~~~~d~~s~lFv 189 (933)
T KOG2114|consen 110 CLYEHRIFTIKNPTNPSPASSLAVSEDLKTIVCGFTNGLVICYKGDILRDRGSRQDYSHRGKEPITGLALRSDGKSVLFV 189 (933)
T ss_pred eeeeeeeeccCCCCCCCcceEEEEEccccEEEEEecCcEEEEEcCcchhccccceeeeccCCCCceeeEEecCCceeEEE
Confidence 331 1222 356789999999999999999999999984321 11 11111 5689999999998 4566
Q ss_pred EcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 165 GTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 165 ~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
.+...|.+|.+... .+......+ +|..+.|..|++....+++++..
T Consensus 190 ~Tt~~V~~y~l~gr-~p~~~~ld~---~G~~lnCss~~~~t~qfIca~~e 235 (933)
T KOG2114|consen 190 ATTEQVMLYSLSGR-TPSLKVLDN---NGISLNCSSFSDGTYQFICAGSE 235 (933)
T ss_pred EecceeEEEEecCC-Ccceeeecc---CCccceeeecCCCCccEEEecCc
Confidence 66778999986533 222222222 55588888888766544444443
No 330
>PRK13616 lipoprotein LpqB; Provisional
Probab=97.68 E-value=0.003 Score=62.14 Aligned_cols=161 Identities=16% Similarity=0.062 Sum_probs=94.6
Q ss_pred eEEEECCCCCEEEEec-------c---------------------ceeEEEEcCCCCEEEEEeCC------------CeE
Q 040274 52 ILWILPSSGRYMAVAG-------R---------------------RTDLMRVNPFNGVVSLGHSG------------GTV 91 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~-------~---------------------~v~~l~~sp~~~~l~tg~~d------------g~v 91 (359)
.+.++||||+.+++.. . ..+.-.|+|+|..|.+.+.. +.+
T Consensus 353 sspaiSpdG~~vA~v~~~~~~~~d~~s~Lwv~~~gg~~~~lt~g~~~t~PsWspDG~~lw~v~dg~~~~~v~~~~~~gql 432 (591)
T PRK13616 353 TSAALSRSGRQVAAVVTLGRGAPDPASSLWVGPLGGVAVQVLEGHSLTRPSWSLDADAVWVVVDGNTVVRVIRDPATGQL 432 (591)
T ss_pred ccceECCCCCEEEEEEeecCCCCCcceEEEEEeCCCcceeeecCCCCCCceECCCCCceEEEecCcceEEEeccCCCceE
Confidence 5777888888776543 1 45678899998877776532 233
Q ss_pred EEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEE---EEcCCCee-e---Eee----cCCceeEEEcCCC
Q 040274 92 TMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKI---WDLRKYEV-L---QTL----TGHAKTLDFSQKG 160 (359)
Q Consensus 92 ~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~v---wd~~~~~~-~---~~~----~~~v~~~~~s~~g 160 (359)
.+.++..+.... ...+.|..+.|+|||..++... ++.|++ -....|.. + ..+ ...+.++.|.+++
T Consensus 433 ~~~~vd~ge~~~---~~~g~Issl~wSpDG~RiA~i~-~g~v~Va~Vvr~~~G~~~l~~~~~l~~~l~~~~~~l~W~~~~ 508 (591)
T PRK13616 433 ARTPVDASAVAS---RVPGPISELQLSRDGVRAAMII-GGKVYLAVVEQTEDGQYALTNPREVGPGLGDTAVSLDWRTGD 508 (591)
T ss_pred EEEeccCchhhh---ccCCCcCeEEECCCCCEEEEEE-CCEEEEEEEEeCCCCceeecccEEeecccCCccccceEecCC
Confidence 333444333222 2256799999999999887765 477777 33333431 1 112 2346889999999
Q ss_pred -cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEE
Q 040274 161 -LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGIL 220 (359)
Q Consensus 161 -l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~ 220 (359)
|+.+..++...+|.+.-.+.....+.... ....+.+++=++. .|+++..+|.+.+-
T Consensus 509 ~L~V~~~~~~~~v~~v~vDG~~~~~~~~~n--~~~~v~~vaa~~~--~iyv~~~~g~~~l~ 565 (591)
T PRK13616 509 SLVVGRSDPEHPVWYVNLDGSNSDALPSRN--LSAPVVAVAASPS--TVYVTDARAVLQLP 565 (591)
T ss_pred EEEEEecCCCCceEEEecCCccccccCCCC--ccCceEEEecCCc--eEEEEcCCceEEec
Confidence 66655554444554333333322222221 2235777776653 56667777754443
No 331
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=97.64 E-value=0.0012 Score=61.63 Aligned_cols=131 Identities=15% Similarity=-0.003 Sum_probs=83.9
Q ss_pred CCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec---CC-ceeE
Q 040274 79 NGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT---GH-AKTL 154 (359)
Q Consensus 79 ~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~---~~-v~~~ 154 (359)
+..+++++.+|.+..||+.+++.+..... . ....+. .++..++.++.||.|..+|..+++.+..+. +. ..+.
T Consensus 241 ~~~vy~~~~~g~l~a~d~~tG~~~W~~~~-~-~~~~p~--~~~~~vyv~~~~G~l~~~d~~tG~~~W~~~~~~~~~~ssp 316 (377)
T TIGR03300 241 GGQVYAVSYQGRVAALDLRSGRVLWKRDA-S-SYQGPA--VDDNRLYVTDADGVVVALDRRSGSELWKNDELKYRQLTAP 316 (377)
T ss_pred CCEEEEEEcCCEEEEEECCCCcEEEeecc-C-CccCce--EeCCEEEEECCCCeEEEEECCCCcEEEccccccCCccccC
Confidence 45777888899999999999987766542 1 112222 245678888899999999999998876552 21 2333
Q ss_pred EEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEE
Q 040274 155 DFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGIL 220 (359)
Q Consensus 155 ~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~ 220 (359)
... ++ +++++.+|.|+++|..++ +....+..+.. ....+..+. + +.|++++.||.+..|
T Consensus 317 ~i~-g~~l~~~~~~G~l~~~d~~tG-~~~~~~~~~~~---~~~~sp~~~-~-~~l~v~~~dG~l~~~ 376 (377)
T TIGR03300 317 AVV-GGYLVVGDFEGYLHWLSREDG-SFVARLKTDGS---GIASPPVVV-G-DGLLVQTRDGDLYAF 376 (377)
T ss_pred EEE-CCEEEEEeCCCEEEEEECCCC-CEEEEEEcCCC---ccccCCEEE-C-CEEEEEeCCceEEEe
Confidence 332 33 778888999999995554 44444443321 011222222 3 458888888876543
No 332
>PRK02888 nitrous-oxide reductase; Validated
Probab=97.62 E-value=0.003 Score=61.17 Aligned_cols=162 Identities=9% Similarity=-0.004 Sum_probs=93.9
Q ss_pred CCCCEEEEeccceeEEEEcCCCCEEEE-EeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEec--------
Q 040274 58 SSGRYMAVAGRRTDLMRVNPFNGVVSL-GHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTG-------- 128 (359)
Q Consensus 58 pdg~~l~~~~~~v~~l~~sp~~~~l~t-g~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~-------- 128 (359)
|+-.|++.++. ..+-++|||..+.. .-..+.+.+.|..+.+....+.-.. ....+.++|+|.++++++
T Consensus 185 p~t~yv~~~~e--~~~PlpnDGk~l~~~~ey~~~vSvID~etmeV~~qV~Vdg-npd~v~~spdGk~afvTsyNsE~G~t 261 (635)
T PRK02888 185 PRTGYVFCNGE--FRIPLPNDGKDLDDPKKYRSLFTAVDAETMEVAWQVMVDG-NLDNVDTDYDGKYAFSTCYNSEEGVT 261 (635)
T ss_pred CCccEEEeCcc--cccccCCCCCEeecccceeEEEEEEECccceEEEEEEeCC-CcccceECCCCCEEEEeccCcccCcc
Confidence 56666665543 33344556654432 2234566666766655554443212 234456666666655543
Q ss_pred --------------------------------CCCeEEEEEcCC-----CeeeEee--cCCceeEEEcCCC---cEEEEc
Q 040274 129 --------------------------------KECKIKIWDLRK-----YEVLQTL--TGHAKTLDFSQKG---LLAVGT 166 (359)
Q Consensus 129 --------------------------------~d~~i~vwd~~~-----~~~~~~~--~~~v~~~~~s~~g---l~~~~~ 166 (359)
.++.|.+.|..+ ...+..+ ...+..+.+|||| ++++..
T Consensus 262 l~em~a~e~d~~vvfni~~iea~vkdGK~~~V~gn~V~VID~~t~~~~~~~v~~yIPVGKsPHGV~vSPDGkylyVankl 341 (635)
T PRK02888 262 LAEMMAAERDWVVVFNIARIEEAVKAGKFKTIGGSKVPVVDGRKAANAGSALTRYVPVPKNPHGVNTSPDGKYFIANGKL 341 (635)
T ss_pred eeeeccccCceEEEEchHHHHHhhhCCCEEEECCCEEEEEECCccccCCcceEEEEECCCCccceEECCCCCEEEEeCCC
Confidence 235688888887 3455555 4457899999999 344445
Q ss_pred CCcEEEEcCCCCCccc-------cccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 167 GSFAQILGDFSGSHNY-------SRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 167 d~~i~v~d~~~~~~~~-------~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
+++|.|+|+....... ..+..... -+.......|.++|....+-.-|..+..|...
T Consensus 342 S~tVSVIDv~k~k~~~~~~~~~~~~vvaeve-vGlGPLHTaFDg~G~aytslf~dsqv~kwn~~ 404 (635)
T PRK02888 342 SPTVTVIDVRKLDDLFDGKIKPRDAVVAEPE-LGLGPLHTAFDGRGNAYTTLFLDSQIVKWNIE 404 (635)
T ss_pred CCcEEEEEChhhhhhhhccCCccceEEEeec-cCCCcceEEECCCCCEEEeEeecceeEEEehH
Confidence 7999999976532211 11111100 12245567899998877777777777666543
No 333
>PF14783 BBS2_Mid: Ciliary BBSome complex subunit 2, middle region
Probab=97.62 E-value=0.004 Score=46.34 Aligned_cols=97 Identities=16% Similarity=0.205 Sum_probs=65.9
Q ss_pred eEEEEEec---CC-CEEEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccc
Q 040274 112 VSALAFHP---NG-HLMATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSR 184 (359)
Q Consensus 112 v~~l~~~p---~g-~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~ 184 (359)
|+++++.. +| +.|+.|+.|..|++|+-. ..+.++ .+.+++++-...+ ++.+-.+|+|-+|+-.. .....
T Consensus 2 V~al~~~d~d~dg~~eLlvGs~D~~IRvf~~~--e~~~Ei~e~~~v~~L~~~~~~~F~Y~l~NGTVGvY~~~~--RlWRi 77 (111)
T PF14783_consen 2 VTALCLFDFDGDGENELLVGSDDFEIRVFKGD--EIVAEITETDKVTSLCSLGGGRFAYALANGTVGVYDRSQ--RLWRI 77 (111)
T ss_pred eeEEEEEecCCCCcceEEEecCCcEEEEEeCC--cEEEEEecccceEEEEEcCCCEEEEEecCCEEEEEeCcc--eeeee
Confidence 56777654 33 569999999999999765 556666 5668888888778 88888899999998321 22222
Q ss_pred cccccCCCCcceeEEEEccC---C-CEEEEEeCCCeEE
Q 040274 185 YMGNSMVKGYQIGKVSFRPY---E-DVLGIGHSMGWSG 218 (359)
Q Consensus 185 ~~~~~~~~~~~v~~~~~sp~---~-~~l~~g~~dg~~~ 218 (359)
-..+ .++++.+..- | ..|++|-.+|.+.
T Consensus 78 KSK~------~~~~~~~~D~~gdG~~eLI~GwsnGkve 109 (111)
T PF14783_consen 78 KSKN------QVTSMAFYDINGDGVPELIVGWSNGKVE 109 (111)
T ss_pred ccCC------CeEEEEEEcCCCCCceEEEEEecCCeEE
Confidence 1222 4666655542 2 3688888888664
No 334
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=97.60 E-value=0.0026 Score=59.43 Aligned_cols=143 Identities=13% Similarity=0.074 Sum_probs=86.4
Q ss_pred CCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec--CCceeEE
Q 040274 78 FNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT--GHAKTLD 155 (359)
Q Consensus 78 ~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~--~~v~~~~ 155 (359)
.+..+++++.+|.|..+|..+|+.+..+........++.. ++..++.++.++.++.||..+|+.+.... +.+.+.-
T Consensus 64 ~~~~v~v~~~~g~v~a~d~~tG~~~W~~~~~~~~~~~p~v--~~~~v~v~~~~g~l~ald~~tG~~~W~~~~~~~~~~~p 141 (377)
T TIGR03300 64 AGGKVYAADADGTVVALDAETGKRLWRVDLDERLSGGVGA--DGGLVFVGTEKGEVIALDAEDGKELWRAKLSSEVLSPP 141 (377)
T ss_pred ECCEEEEECCCCeEEEEEccCCcEeeeecCCCCcccceEE--cCCEEEEEcCCCEEEEEECCCCcEeeeeccCceeecCC
Confidence 3668888989999999999999988776644432223332 46678888899999999999999877662 3222111
Q ss_pred EcCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCC-cceeEEEEccCCCEEEEEeCCCeEEEEEcCCC
Q 040274 156 FSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKG-YQIGKVSFRPYEDVLGIGHSMGWSGILVPRSS 225 (359)
Q Consensus 156 ~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~-~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~ 225 (359)
...++ ++.++.++.|..||..++. ..-.+........ ....+... .+..+++++.+|.+..+...++
T Consensus 142 ~v~~~~v~v~~~~g~l~a~d~~tG~-~~W~~~~~~~~~~~~~~~sp~~--~~~~v~~~~~~g~v~ald~~tG 210 (377)
T TIGR03300 142 LVANGLVVVRTNDGRLTALDAATGE-RLWTYSRVTPALTLRGSASPVI--ADGGVLVGFAGGKLVALDLQTG 210 (377)
T ss_pred EEECCEEEEECCCCeEEEEEcCCCc-eeeEEccCCCceeecCCCCCEE--ECCEEEEECCCCEEEEEEccCC
Confidence 11234 6667778999999966553 2222111100000 00011111 1246677777777666655444
No 335
>KOG3621 consensus WD40 repeat-containing protein [General function prediction only]
Probab=97.60 E-value=0.00055 Score=65.71 Aligned_cols=113 Identities=11% Similarity=0.022 Sum_probs=79.0
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeE-ee---cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccc
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQ-TL---TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNY 182 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~-~~---~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~ 182 (359)
...|.--+++..+.+++.|+..|.+++|+-..+.... .. .+.+..++.|++. +++++..|.|.+|.+.......
T Consensus 33 ~~~v~lTc~dst~~~l~~GsS~G~lyl~~R~~~~~~~~~~~~~~~~~~~~~vs~~e~lvAagt~~g~V~v~ql~~~~p~~ 112 (726)
T KOG3621|consen 33 PARVKLTCVDATEEYLAMGSSAGSVYLYNRHTGEMRKLKNEGATGITCVRSVSSVEYLVAAGTASGRVSVFQLNKELPRD 112 (726)
T ss_pred cceEEEEEeecCCceEEEecccceEEEEecCchhhhcccccCccceEEEEEecchhHhhhhhcCCceEEeehhhccCCCc
Confidence 3445555667788999999999999999977665422 22 2335667778887 4455566888888765543333
Q ss_pred cccccccC-CCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 183 SRYMGNSM-VKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 183 ~~~~~~~~-~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
..|..+.. .|+..|++++|++++..+++|...|.+....
T Consensus 113 ~~~~t~~d~~~~~rVTal~Ws~~~~k~ysGD~~Gkv~~~~ 152 (726)
T KOG3621|consen 113 LDYVTPCDKSHKCRVTALEWSKNGMKLYSGDSQGKVVLTE 152 (726)
T ss_pred ceeeccccccCCceEEEEEecccccEEeecCCCceEEEEE
Confidence 33433322 1566899999999999999999999876643
No 336
>KOG2114 consensus Vacuolar assembly/sorting protein PEP5/VPS11 [Intracellular trafficking, secretion, and vesicular transport]
Probab=97.59 E-value=0.0029 Score=62.24 Aligned_cols=130 Identities=18% Similarity=0.242 Sum_probs=84.7
Q ss_pred EEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCC-eEEEEEecCCCEEEEecCCC-----eEEEEEcCC------C
Q 040274 74 RVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGP-VSALAFHPNGHLMATTGKEC-----KIKIWDLRK------Y 141 (359)
Q Consensus 74 ~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~-v~~l~~~p~g~~l~s~~~d~-----~i~vwd~~~------~ 141 (359)
+|++.+..++.|+.+|.|.+++-. -+.+..|.++... |..+....+.++|++.+.|+ .|++||+.. .
T Consensus 30 c~~s~~~~vvigt~~G~V~~Ln~s-~~~~~~fqa~~~siv~~L~~~~~~~~L~sv~Ed~~~np~llkiw~lek~~~n~sP 108 (933)
T KOG2114|consen 30 CCSSSTGSVVIGTADGRVVILNSS-FQLIRGFQAYEQSIVQFLYILNKQNFLFSVGEDEQGNPVLLKIWDLEKVDKNNSP 108 (933)
T ss_pred EEcCCCceEEEeeccccEEEeccc-ceeeehheecchhhhhHhhcccCceEEEEEeecCCCCceEEEEecccccCCCCCc
Confidence 367888999999999999887633 3444677777666 55555444557888887764 489999864 2
Q ss_pred eeeEee----------cCCceeEEEcCCC-cEEEE-cCCcEEEEcC--CCCCccccccccccCCCCcceeEEEEccCCCE
Q 040274 142 EVLQTL----------TGHAKTLDFSQKG-LLAVG-TGSFAQILGD--FSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDV 207 (359)
Q Consensus 142 ~~~~~~----------~~~v~~~~~s~~g-l~~~~-~d~~i~v~d~--~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~ 207 (359)
.++..+ +.++++++.|.+- .+++| .+|.|.++.- ... ........|. ...+|+.+.|..++..
T Consensus 109 ~c~~~~ri~~~~np~~~~p~s~l~Vs~~l~~Iv~Gf~nG~V~~~~GDi~RD-rgsr~~~~~~--~~~pITgL~~~~d~~s 185 (933)
T KOG2114|consen 109 QCLYEHRIFTIKNPTNPSPASSLAVSEDLKTIVCGFTNGLVICYKGDILRD-RGSRQDYSHR--GKEPITGLALRSDGKS 185 (933)
T ss_pred ceeeeeeeeccCCCCCCCcceEEEEEccccEEEEEecCcEEEEEcCcchhc-cccceeeecc--CCCCceeeEEecCCce
Confidence 334222 2346888888887 55555 4678877751 111 1112222332 3458999999999877
No 337
>KOG1832 consensus HIV-1 Vpr-binding protein [Cell cycle control, cell division, chromosome partitioning]
Probab=97.54 E-value=4.5e-05 Score=74.60 Aligned_cols=127 Identities=15% Similarity=0.159 Sum_probs=77.9
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeec----CCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLY----HQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVL 144 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~----h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~ 144 (359)
...++.|+.....-+.|.....+.+||+.|+.++.++.. ..-.-+++.|+|+..+++- || .+||++..+.+
T Consensus 1186 ed~~vkFsn~~q~r~~gt~~d~a~~YDvqT~~~l~tylt~~~~~~y~~n~a~FsP~D~LIln---dG--vLWDvR~~~aI 1260 (1516)
T KOG1832|consen 1186 EDKAVKFSNSLQFRALGTEADDALLYDVQTCSPLQTYLTDTVTSSYSNNLAHFSPCDTLILN---DG--VLWDVRIPEAI 1260 (1516)
T ss_pred ccceeehhhhHHHHHhcccccceEEEecccCcHHHHhcCcchhhhhhccccccCCCcceEee---Cc--eeeeeccHHHH
Confidence 344455544333333344344578888888877766432 2223477889998887753 44 58999998888
Q ss_pred EeecC-Cc-eeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEe
Q 040274 145 QTLTG-HA-KTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGH 212 (359)
Q Consensus 145 ~~~~~-~v-~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~ 212 (359)
+.|.. .+ ..-.|+|+| ++.-+ .|||+++- ..+...+.. .-+.+.|+..|++++..-
T Consensus 1261 h~FD~ft~~~~G~FHP~g~eVIINS-----EIwD~RTF-~lLh~VP~L------dqc~VtFNstG~VmYa~~ 1320 (1516)
T KOG1832|consen 1261 HRFDQFTDYGGGGFHPSGNEVIINS-----EIWDMRTF-KLLHSVPSL------DQCAVTFNSTGDVMYAML 1320 (1516)
T ss_pred hhhhhheecccccccCCCceEEeec-----hhhhhHHH-HHHhcCccc------cceEEEeccCccchhhhh
Confidence 88832 11 234689999 33333 58997654 333333332 457788999998776443
No 338
>COG3391 Uncharacterized conserved protein [Function unknown]
Probab=97.52 E-value=0.027 Score=52.65 Aligned_cols=146 Identities=14% Similarity=0.198 Sum_probs=98.7
Q ss_pred ceeEEEEcCCCCEEEEEeC---CCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEec-CCCeEEEEEcCCCeee
Q 040274 69 RTDLMRVNPFNGVVSLGHS---GGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTG-KECKIKIWDLRKYEVL 144 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~---dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~-~d~~i~vwd~~~~~~~ 144 (359)
....++++|++..++.+.. +++|.+.|..+...+........+ ..++++|+|..++.+. .++.|.+.|.......
T Consensus 117 ~P~~~~~~~~~~~vYV~n~~~~~~~vsvid~~t~~~~~~~~vG~~P-~~~a~~p~g~~vyv~~~~~~~v~vi~~~~~~v~ 195 (381)
T COG3391 117 GPVGLAVDPDGKYVYVANAGNGNNTVSVIDAATNKVTATIPVGNTP-TGVAVDPDGNKVYVTNSDDNTVSVIDTSGNSVV 195 (381)
T ss_pred CCceEEECCCCCEEEEEecccCCceEEEEeCCCCeEEEEEecCCCc-ceEEECCCCCeEEEEecCCCeEEEEeCCCccee
Confidence 4567889999987777665 689999999988887775543445 8899999999766555 7889999997766555
Q ss_pred E-e----e--cCCceeEEEcCCC---cEEEEcC--CcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEe
Q 040274 145 Q-T----L--TGHAKTLDFSQKG---LLAVGTG--SFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGH 212 (359)
Q Consensus 145 ~-~----~--~~~v~~~~~s~~g---l~~~~~d--~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~ 212 (359)
. . + ......+.++|+| +++...+ +.+...|.....-....+... .. ....+.++|+|.++.+..
T Consensus 196 ~~~~~~~~~~~~~P~~i~v~~~g~~~yV~~~~~~~~~v~~id~~~~~v~~~~~~~~---~~-~~~~v~~~p~g~~~yv~~ 271 (381)
T COG3391 196 RGSVGSLVGVGTGPAGIAVDPDGNRVYVANDGSGSNNVLKIDTATGNVTATDLPVG---SG-APRGVAVDPAGKAAYVAN 271 (381)
T ss_pred ccccccccccCCCCceEEECCCCCEEEEEeccCCCceEEEEeCCCceEEEeccccc---cC-CCCceeECCCCCEEEEEe
Confidence 3 1 1 2234788999999 3333333 578888855442111112221 11 356688999999998886
Q ss_pred CC-CeEEE
Q 040274 213 SM-GWSGI 219 (359)
Q Consensus 213 ~d-g~~~i 219 (359)
.. +.+.+
T Consensus 272 ~~~~~V~v 279 (381)
T COG3391 272 SQGGTVSV 279 (381)
T ss_pred cCCCeEEE
Confidence 65 44444
No 339
>KOG1275 consensus PAB-dependent poly(A) ribonuclease, subunit PAN2 [Replication, recombination and repair]
Probab=97.52 E-value=0.0013 Score=64.93 Aligned_cols=97 Identities=11% Similarity=0.102 Sum_probs=69.0
Q ss_pred CEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecC---CceeEEE
Q 040274 80 GVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTG---HAKTLDF 156 (359)
Q Consensus 80 ~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~---~v~~~~~ 156 (359)
..++.|+....+..+|+++.+......-..+.|+-+. .+++++.+|...|+|.+-|.++.+.++++.. .+.+++.
T Consensus 148 ~~~i~Gg~Q~~li~~Dl~~~~e~r~~~v~a~~v~imR--~Nnr~lf~G~t~G~V~LrD~~s~~~iht~~aHs~siSDfDv 225 (1118)
T KOG1275|consen 148 STLIMGGLQEKLIHIDLNTEKETRTTNVSASGVTIMR--YNNRNLFCGDTRGTVFLRDPNSFETIHTFDAHSGSISDFDV 225 (1118)
T ss_pred cceeecchhhheeeeecccceeeeeeeccCCceEEEE--ecCcEEEeecccceEEeecCCcCceeeeeeccccceeeeec
Confidence 3455565556677788888776665544444455554 4678999999999999999999999999954 4555554
Q ss_pred cCCCcEEEEc---------CCcEEEEcCCCC
Q 040274 157 SQKGLLAVGT---------GSFAQILGDFSG 178 (359)
Q Consensus 157 s~~gl~~~~~---------d~~i~v~d~~~~ 178 (359)
..+-+++||. |..|.|||++.-
T Consensus 226 ~GNlLitCG~S~R~~~l~~D~FvkVYDLRmm 256 (1118)
T KOG1275|consen 226 QGNLLITCGYSMRRYNLAMDPFVKVYDLRMM 256 (1118)
T ss_pred cCCeEEEeecccccccccccchhhhhhhhhh
Confidence 4333888875 457889997654
No 340
>KOG2395 consensus Protein involved in vacuole import and degradation [Intracellular trafficking, secretion, and vesicular transport]
Probab=97.48 E-value=0.0028 Score=59.18 Aligned_cols=132 Identities=9% Similarity=0.051 Sum_probs=91.5
Q ss_pred EEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCE--E-----EEecCCCeEEEEEcCCC-e-eeEeec----
Q 040274 82 VSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHL--M-----ATTGKECKIKIWDLRKY-E-VLQTLT---- 148 (359)
Q Consensus 82 l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~--l-----~s~~~d~~i~vwd~~~~-~-~~~~~~---- 148 (359)
|.++.....++-.|+..|+.+..+.-|.. |+-+.+.|+... | +.|-.|..|+-||+|-. . .+..-.
T Consensus 349 l~~~~~~~~l~klDIE~GKIVeEWk~~~d-i~mv~~t~d~K~~Ql~~e~TlvGLs~n~vfriDpRv~~~~kl~~~q~kqy 427 (644)
T KOG2395|consen 349 LMDGGEQDKLYKLDIERGKIVEEWKFEDD-INMVDITPDFKFAQLTSEQTLVGLSDNSVFRIDPRVQGKNKLAVVQSKQY 427 (644)
T ss_pred eeCCCCcCcceeeecccceeeeEeeccCC-cceeeccCCcchhcccccccEEeecCCceEEecccccCcceeeeeecccc
Confidence 33444555688888999998888877666 777888886432 2 23456788999999842 2 111111
Q ss_pred ---CCceeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 149 ---GHAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 149 ---~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
..-.|++-..+| ++++|.+|.|++|| +.+......+++. +.+|..+..+.+|.+|+..+..-.+-|
T Consensus 428 ~~k~nFsc~aTT~sG~IvvgS~~GdIRLYd-ri~~~AKTAlPgL----G~~I~hVdvtadGKwil~Tc~tyLlLi 497 (644)
T KOG2395|consen 428 STKNNFSCFATTESGYIVVGSLKGDIRLYD-RIGRRAKTALPGL----GDAIKHVDVTADGKWILATCKTYLLLI 497 (644)
T ss_pred ccccccceeeecCCceEEEeecCCcEEeeh-hhhhhhhhccccc----CCceeeEEeeccCcEEEEecccEEEEE
Confidence 224677777888 88899999999999 5554445555554 348999999999999987776654433
No 341
>KOG4649 consensus PQQ (pyrrolo-quinoline quinone) repeat protein [Secondary metabolites biosynthesis, transport and catabolism]
Probab=97.47 E-value=0.018 Score=49.36 Aligned_cols=96 Identities=15% Similarity=0.137 Sum_probs=71.5
Q ss_pred CCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee--cCCc-eeE
Q 040274 78 FNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL--TGHA-KTL 154 (359)
Q Consensus 78 ~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v-~~~ 154 (359)
-|.+++.|+.+|.+++.+..+|.....+..-..--......+++.++..++.|++.+..|+++..++... .+.+ .+.
T Consensus 62 vgdfVV~GCy~g~lYfl~~~tGs~~w~f~~~~~vk~~a~~d~~~glIycgshd~~~yalD~~~~~cVykskcgG~~f~sP 141 (354)
T KOG4649|consen 62 VGDFVVLGCYSGGLYFLCVKTGSQIWNFVILETVKVRAQCDFDGGLIYCGSHDGNFYALDPKTYGCVYKSKCGGGTFVSP 141 (354)
T ss_pred ECCEEEEEEccCcEEEEEecchhheeeeeehhhhccceEEcCCCceEEEecCCCcEEEecccccceEEecccCCceeccc
Confidence 3668999999999999999999888887653332234556789999999999999999999998888776 3333 344
Q ss_pred EEcC-CC-cEEEEcCCcEEEE
Q 040274 155 DFSQ-KG-LLAVGTGSFAQIL 173 (359)
Q Consensus 155 ~~s~-~g-l~~~~~d~~i~v~ 173 (359)
++.| ++ ++++...|.+.-.
T Consensus 142 ~i~~g~~sly~a~t~G~vlav 162 (354)
T KOG4649|consen 142 VIAPGDGSLYAAITAGAVLAV 162 (354)
T ss_pred eecCCCceEEEEeccceEEEE
Confidence 5555 45 6666666655443
No 342
>KOG4190 consensus Uncharacterized conserved protein [Function unknown]
Probab=97.43 E-value=0.00034 Score=65.18 Aligned_cols=121 Identities=17% Similarity=0.183 Sum_probs=77.7
Q ss_pred eEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC-------CeeeEee---cCCceeEEEcCCCcEEEEcCCcEE
Q 040274 102 LIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRK-------YEVLQTL---TGHAKTLDFSQKGLLAVGTGSFAQ 171 (359)
Q Consensus 102 ~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~-------~~~~~~~---~~~v~~~~~s~~gl~~~~~d~~i~ 171 (359)
+..|.+|...|..++--.+.+.+++++.|.+|++|.++. ..+..++ ..+|.++.|-.+.-..++.|+.|+
T Consensus 728 L~nf~GH~~~iRai~AidNENSFiSASkDKTVKLWSik~EgD~~~tsaCQfTY~aHkk~i~~igfL~~lr~i~ScD~giH 807 (1034)
T KOG4190|consen 728 LCNFTGHQEKIRAIAAIDNENSFISASKDKTVKLWSIKPEGDEIGTSACQFTYQAHKKPIHDIGFLADLRSIASCDGGIH 807 (1034)
T ss_pred eecccCcHHHhHHHHhcccccceeeccCCceEEEEEeccccCccccceeeeEhhhccCcccceeeeeccceeeeccCcce
Confidence 456779999888887777888999999999999999874 2355565 456888888777645677899999
Q ss_pred EEcCCCCCcccc-ccccccCCCCcceeEEEEcc--CCCEEEEE-eCCCeEEEEEcCCCC
Q 040274 172 ILGDFSGSHNYS-RYMGNSMVKGYQIGKVSFRP--YEDVLGIG-HSMGWSGILVPRSSE 226 (359)
Q Consensus 172 v~d~~~~~~~~~-~~~~~~~~~~~~v~~~~~sp--~~~~l~~g-~~dg~~~i~~~gs~~ 226 (359)
+||...+ .... ...... ++ .+..+..-| +..++..| +...++.++..-+.+
T Consensus 808 lWDPFig-r~Laq~~dapk--~~-a~~~ikcl~nv~~~iliAgcsaeSTVKl~DaRsce 862 (1034)
T KOG4190|consen 808 LWDPFIG-RLLAQMEDAPK--EG-AGGNIKCLENVDRHILIAGCSAESTVKLFDARSCE 862 (1034)
T ss_pred eeccccc-chhHhhhcCcc--cC-CCceeEecccCcchheeeeccchhhheeeeccccc
Confidence 9996554 3333 222211 11 233333333 33334333 456666666554444
No 343
>PF00930 DPPIV_N: Dipeptidyl peptidase IV (DPP IV) N-terminal region; InterPro: IPR002469 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This domain defines serine peptidases belonging to MEROPS peptidase family S9 (clan SC), subfamily S9B (dipeptidyl-peptidase IV). The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. This domain is an alignment of the region to the N-terminal side of the active site, which is found in IPR001375 from INTERPRO. CD26 (3.4.14.5 from EC) is also called adenosine deaminase-binding protein (ADA-binding protein) or dipeptidylpeptidase IV (DPP IV ectoenzyme). The exopeptidase cleaves off N-terminal X-Pro or X-Ala dipeptides from polypeptides (dipeptidyl peptidase IV activity). CD26 serves as the costimulatory molecule in T cell activation and is an associated marker of autoimmune diseases, adenosine deaminase-deficiency and HIV pathogenesis. Dipeptidyl peptidase IV (DPP IV) is responsible for the removal of N-terminal dipeptides sequentially from polypeptides having unsubstituted N termini, provided that the penultimate residue is proline. The enzyme catalyses the reaction: Dipeptidyl-Polypeptide + H(2)O = Dipeptide + Polypeptide It is a type II membrane protein that forms a homodimer. CD molecules are leucocyte antigens on cell surfaces. CD antigens nomenclature is updated at Protein Reviews On The Web (http://prow.nci.nih.gov/). ; GO: 0006508 proteolysis, 0016020 membrane; PDB: 2RIP_A 3Q8W_B 2AJL_I 1TKR_B 1TK3_B 3C45_A 2G5P_A 3G0C_D 1R9M_C 1RWQ_A ....
Probab=97.43 E-value=0.016 Score=53.68 Aligned_cols=60 Identities=10% Similarity=0.016 Sum_probs=40.8
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee-cC----------------CCCeEEEEEecCCCEEEEecC
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML-YH----------------QGPVSALAFHPNGHLMATTGK 129 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~-~h----------------~~~v~~l~~~p~g~~l~s~~~ 129 (359)
.+....|||+|..++... ++.|.+++..++....... +- -+.-.++-|||||++|+....
T Consensus 44 ~~~~~~~sP~g~~~~~v~-~~nly~~~~~~~~~~~lT~dg~~~i~nG~~dwvyeEEv~~~~~~~~WSpd~~~la~~~~ 120 (353)
T PF00930_consen 44 KLQDAKWSPDGKYIAFVR-DNNLYLRDLATGQETQLTTDGEPGIYNGVPDWVYEEEVFDRRSAVWWSPDSKYLAFLRF 120 (353)
T ss_dssp TBSEEEE-SSSTEEEEEE-TTEEEEESSTTSEEEESES--TTTEEESB--HHHHHHTSSSSBSEEE-TTSSEEEEEEE
T ss_pred ccccceeecCCCeeEEEe-cCceEEEECCCCCeEEeccccceeEEcCccceeccccccccccceEECCCCCEEEEEEE
Confidence 588899999999999886 5789999987774332211 20 122366889999999887643
No 344
>PF06977 SdiA-regulated: SdiA-regulated; InterPro: IPR009722 This entry represents a conserved region approximately 100 residues long within a number of hypothetical bacterial proteins that may be regulated by SdiA, a member of the LuxR family of transcriptional regulators []. Some proteins contain the IPR001258 from INTERPRO repeat.; PDB: 3QQZ_A.
Probab=97.42 E-value=0.02 Score=49.85 Aligned_cols=184 Identities=14% Similarity=0.164 Sum_probs=97.9
Q ss_pred ceeEEEEcCCCC-EEEEEeCCCeEEEEeCCCCcceEEeecC-CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCe----
Q 040274 69 RTDLMRVNPFNG-VVSLGHSGGTVTMWKPTTSALLIKMLYH-QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYE---- 142 (359)
Q Consensus 69 ~v~~l~~sp~~~-~l~tg~~dg~v~lwd~~~~~~~~~~~~h-~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~---- 142 (359)
.++.|+|+|++. ++++....+.|..++.. |+.+..+.-. .+..-++++..++.++++.-.++.+.++++....
T Consensus 23 e~SGLTy~pd~~tLfaV~d~~~~i~els~~-G~vlr~i~l~g~~D~EgI~y~g~~~~vl~~Er~~~L~~~~~~~~~~~~~ 101 (248)
T PF06977_consen 23 ELSGLTYNPDTGTLFAVQDEPGEIYELSLD-GKVLRRIPLDGFGDYEGITYLGNGRYVLSEERDQRLYIFTIDDDTTSLD 101 (248)
T ss_dssp -EEEEEEETTTTEEEEEETTTTEEEEEETT---EEEEEE-SS-SSEEEEEE-STTEEEEEETTTTEEEEEEE----TT--
T ss_pred CccccEEcCCCCeEEEEECCCCEEEEEcCC-CCEEEEEeCCCCCCceeEEEECCCEEEEEEcCCCcEEEEEEeccccccc
Confidence 589999999755 56666677888888864 7777776532 4667889998888888877779999999984321
Q ss_pred --eeEee----c----CCceeEEEcCCC--cEEEEcCCcEEEEcCCC--CCcccc-----ccccccCCCCcceeEEEEcc
Q 040274 143 --VLQTL----T----GHAKTLDFSQKG--LLAVGTGSFAQILGDFS--GSHNYS-----RYMGNSMVKGYQIGKVSFRP 203 (359)
Q Consensus 143 --~~~~~----~----~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~--~~~~~~-----~~~~~~~~~~~~v~~~~~sp 203 (359)
....+ . ...-.++|+|.+ ++++-...-..||.+.. ...... .+..... ....+.++.|+|
T Consensus 102 ~~~~~~~~l~~~~~~N~G~EGla~D~~~~~L~v~kE~~P~~l~~~~~~~~~~~~~~~~~~~~~~~~~-~~~d~S~l~~~p 180 (248)
T PF06977_consen 102 RADVQKISLGFPNKGNKGFEGLAYDPKTNRLFVAKERKPKRLYEVNGFPGGFDLFVSDDQDLDDDKL-FVRDLSGLSYDP 180 (248)
T ss_dssp EEEEEEEE---S---SS--EEEEEETTTTEEEEEEESSSEEEEEEESTT-SS--EEEE-HHHH-HT---SS---EEEEET
T ss_pred hhhceEEecccccCCCcceEEEEEcCCCCEEEEEeCCCChhhEEEccccCccceeeccccccccccc-eeccccceEEcC
Confidence 12222 1 125789999986 66666666556665432 111111 1110111 223588999999
Q ss_pred CCCEEE-EEeCCCeEEEEEcCCCCCceeeeccCCCCChhhhhhHHHHHhhhc-cCCCeeeeCCCC
Q 040274 204 YEDVLG-IGHSMGWSGILVPRSSEPNFDSWVANPFETSKQRREKEVHSLLDK-LLLETIMLNPSK 266 (359)
Q Consensus 204 ~~~~l~-~g~~dg~~~i~~~gs~~~~~~~~~~~~~~~~~~~~e~ev~~ll~~-~~~~~i~~~~~~ 266 (359)
....|+ ....+..+-++. ..|. .+..+...... +.|... -+|+.|++|++.
T Consensus 181 ~t~~lliLS~es~~l~~~d-~~G~-~~~~~~L~~g~----------~gl~~~~~QpEGIa~d~~G 233 (248)
T PF06977_consen 181 RTGHLLILSDESRLLLELD-RQGR-VVSSLSLDRGF----------HGLSKDIPQPEGIAFDPDG 233 (248)
T ss_dssp TTTEEEEEETTTTEEEEE--TT---EEEEEE-STTG----------GG-SS---SEEEEEE-TT-
T ss_pred CCCeEEEEECCCCeEEEEC-CCCC-EEEEEEeCCcc----------cCcccccCCccEEEECCCC
Confidence 765554 444455444443 3232 23444432211 111111 268999999873
No 345
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=97.40 E-value=0.014 Score=50.37 Aligned_cols=141 Identities=16% Similarity=0.066 Sum_probs=87.6
Q ss_pred CCCEEEEEeCCCeEEEEeCCCCcceEEe-ecCC---CCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecCCc--
Q 040274 78 FNGVVSLGHSGGTVTMWKPTTSALLIKM-LYHQ---GPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTGHA-- 151 (359)
Q Consensus 78 ~~~~l~tg~~dg~v~lwd~~~~~~~~~~-~~h~---~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~~v-- 151 (359)
.+..+++++.++.|..+|..+|+.+..+ .... .....+....++..++.+..++.|..+|+.+|+.+..+....
T Consensus 75 ~~~~v~v~~~~~~l~~~d~~tG~~~W~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~g~l~~~d~~tG~~~w~~~~~~~~ 154 (238)
T PF13360_consen 75 DGGRVYVGTSDGSLYALDAKTGKVLWSIYLTSSPPAGVRSSSSPAVDGDRLYVGTSSGKLVALDPKTGKLLWKYPVGEPR 154 (238)
T ss_dssp ETTEEEEEETTSEEEEEETTTSCEEEEEEE-SSCTCSTB--SEEEEETTEEEEEETCSEEEEEETTTTEEEEEEESSTT-
T ss_pred cccccccccceeeeEecccCCcceeeeeccccccccccccccCceEecCEEEEEeccCcEEEEecCCCcEEEEeecCCCC
Confidence 3456777778889999999999998884 3321 112223333347788888889999999999999887772211
Q ss_pred -----------eeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 152 -----------KTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 152 -----------~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
..-....++ ++.++.++.+..+|+.++.... ... .. .+.. ...+++..|++++.++.+.+
T Consensus 155 ~~~~~~~~~~~~~~~~~~~~~v~~~~~~g~~~~~d~~tg~~~w-~~~-~~-----~~~~-~~~~~~~~l~~~~~~~~l~~ 226 (238)
T PF13360_consen 155 GSSPISSFSDINGSPVISDGRVYVSSGDGRVVAVDLATGEKLW-SKP-IS-----GIYS-LPSVDGGTLYVTSSDGRLYA 226 (238)
T ss_dssp SS--EEEETTEEEEEECCTTEEEEECCTSSEEEEETTTTEEEE-EEC-SS------ECE-CEECCCTEEEEEETTTEEEE
T ss_pred CCcceeeecccccceEEECCEEEEEcCCCeEEEEECCCCCEEE-Eec-CC-----CccC-CceeeCCEEEEEeCCCEEEE
Confidence 112222345 5566666654444866553221 111 11 2222 24568888888888898888
Q ss_pred EEcCCCC
Q 040274 220 LVPRSSE 226 (359)
Q Consensus 220 ~~~gs~~ 226 (359)
|...++.
T Consensus 227 ~d~~tG~ 233 (238)
T PF13360_consen 227 LDLKTGK 233 (238)
T ss_dssp EETTTTE
T ss_pred EECCCCC
Confidence 8876654
No 346
>KOG1008 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=97.35 E-value=7.8e-05 Score=70.58 Aligned_cols=146 Identities=13% Similarity=0.118 Sum_probs=96.6
Q ss_pred ceeEEEEcCCC--CEEEEEeCCCeEEEEeCCCCcc--eEEeecCCCCeEEEEEec-CCCEEEEec----CCCeEEEEEcC
Q 040274 69 RTDLMRVNPFN--GVVSLGHSGGTVTMWKPTTSAL--LIKMLYHQGPVSALAFHP-NGHLMATTG----KECKIKIWDLR 139 (359)
Q Consensus 69 ~v~~l~~sp~~--~~l~tg~~dg~v~lwd~~~~~~--~~~~~~h~~~v~~l~~~p-~g~~l~s~~----~d~~i~vwd~~ 139 (359)
.+.|++++.+. .++++|..+|.|-+-..+...- -....+|..++++++|++ |.+.||.|- .|..+.|||+.
T Consensus 58 y~kcva~~y~~d~cIlavG~atG~I~l~s~r~~hdSs~E~tp~~ar~Ct~lAwneLDtn~LAagldkhrnds~~~Iwdi~ 137 (783)
T KOG1008|consen 58 YVKCVASFYGNDRCILAVGSATGNISLLSVRHPHDSSAEVTPGYARPCTSLAWNELDTNHLAAGLDKHRNDSSLKIWDIN 137 (783)
T ss_pred CceeehhhcCCchhhhhhccccCceEEeecCCcccccceecccccccccccccccccHHHHHhhhhhhcccCCccceecc
Confidence 46677766543 4788899999999988764422 223457888999999998 555566553 25679999998
Q ss_pred CC--eeeEee------cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEcc-CCCEE
Q 040274 140 KY--EVLQTL------TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRP-YEDVL 208 (359)
Q Consensus 140 ~~--~~~~~~------~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp-~~~~l 208 (359)
++ .+..+. .....+++|-.+. +++|.....+.++|++..-.....+.+. .+..+...| .++++
T Consensus 138 s~ltvPke~~~fs~~~l~gqns~cwlrd~klvlaGm~sr~~~ifdlRqs~~~~~svnTk------~vqG~tVdp~~~nY~ 211 (783)
T KOG1008|consen 138 SLLTVPKESPLFSSSTLDGQNSVCWLRDTKLVLAGMTSRSVHIFDLRQSLDSVSSVNTK------YVQGITVDPFSPNYF 211 (783)
T ss_pred cccCCCccccccccccccCccccccccCcchhhcccccchhhhhhhhhhhhhhhhhhhh------hcccceecCCCCCce
Confidence 75 222111 1235688898766 6666677899999976443333333332 466677788 55666
Q ss_pred EEEeCCCeEEEEE
Q 040274 209 GIGHSMGWSGILV 221 (359)
Q Consensus 209 ~~g~~dg~~~i~~ 221 (359)
++-+ ||.+.+|.
T Consensus 212 cs~~-dg~iAiwD 223 (783)
T KOG1008|consen 212 CSNS-DGDIAIWD 223 (783)
T ss_pred eccc-cCceeecc
Confidence 6555 88877765
No 347
>COG3490 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=97.30 E-value=0.028 Score=48.82 Aligned_cols=154 Identities=17% Similarity=0.255 Sum_probs=94.8
Q ss_pred CCCCCEEEEecc-------------ceeEEEEcCCC-CEEEEEeCCCe-EEEEeCCCCcceEEeecCCCC--eEEEEEec
Q 040274 57 PSSGRYMAVAGR-------------RTDLMRVNPFN-GVVSLGHSGGT-VTMWKPTTSALLIKMLYHQGP--VSALAFHP 119 (359)
Q Consensus 57 spdg~~l~~~~~-------------~v~~l~~sp~~-~~l~tg~~dg~-v~lwd~~~~~~~~~~~~h~~~--v~~l~~~p 119 (359)
.+||++-+..-. ..+.|+|+|.. .-++.+-.-|+ ..++|+++.+.+.++...++. .-.=.|||
T Consensus 44 ~~dgs~g~a~~~eaGk~v~~~~lpaR~Hgi~~~p~~~ravafARrPGtf~~vfD~~~~~~pv~~~s~~~RHfyGHGvfs~ 123 (366)
T COG3490 44 ARDGSFGAATLSEAGKIVFATALPARGHGIAFHPALPRAVAFARRPGTFAMVFDPNGAQEPVTLVSQEGRHFYGHGVFSP 123 (366)
T ss_pred ccCCceeEEEEccCCceeeeeecccccCCeecCCCCcceEEEEecCCceEEEECCCCCcCcEEEecccCceeecccccCC
Confidence 467776554433 78899999954 45777777775 678999888766655433221 12246899
Q ss_pred CCCEEEEecCC-----CeEEEEEcCCC-eeeEeecCC---ceeEEEcCCC-cEEEEcCCcEEEE----------------
Q 040274 120 NGHLMATTGKE-----CKIKIWDLRKY-EVLQTLTGH---AKTLDFSQKG-LLAVGTGSFAQIL---------------- 173 (359)
Q Consensus 120 ~g~~l~s~~~d-----~~i~vwd~~~~-~~~~~~~~~---v~~~~~s~~g-l~~~~~d~~i~v~---------------- 173 (359)
||.+|+..-.| |.|-|||.+.+ +.+-.++.+ ...+.|.+|| ++++..+ -|...
T Consensus 124 dG~~LYATEndfd~~rGViGvYd~r~~fqrvgE~~t~GiGpHev~lm~DGrtlvvanG-GIethpdfgR~~lNldsMePS 202 (366)
T COG3490 124 DGRLLYATENDFDPNRGVIGVYDAREGFQRVGEFSTHGIGPHEVTLMADGRTLVVANG-GIETHPDFGRTELNLDSMEPS 202 (366)
T ss_pred CCcEEEeecCCCCCCCceEEEEecccccceecccccCCcCcceeEEecCCcEEEEeCC-ceecccccCccccchhhcCcc
Confidence 99999876554 78999999853 344455433 4788999999 5544433 23333
Q ss_pred ----cCCCCCccccccccccCC---CCcceeEEEEccCCCEEEEEeCCC
Q 040274 174 ----GDFSGSHNYSRYMGNSMV---KGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 174 ----d~~~~~~~~~~~~~~~~~---~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
|..++ ..+ ..|..+ +.-.|..++..+||.+++.+-..|
T Consensus 203 lvlld~atG-~li---ekh~Lp~~l~~lSiRHld~g~dgtvwfgcQy~G 247 (366)
T COG3490 203 LVLLDAATG-NLI---EKHTLPASLRQLSIRHLDIGRDGTVWFGCQYRG 247 (366)
T ss_pred EEEEecccc-chh---hhccCchhhhhcceeeeeeCCCCcEEEEEEeeC
Confidence 21111 111 112110 122588888888988777665554
No 348
>PF10647 Gmad1: Lipoprotein LpqB beta-propeller domain; InterPro: IPR018910 The Gmad1 domain is found associated with IPR019606 from INTERPRO, in bacterial spore formation. It is predicted to have a beta-propeller fold and to have a passive binding role rather than a catalytic function owing to the low number of conserved hydrophilic residues.
Probab=97.14 E-value=0.041 Score=48.32 Aligned_cols=144 Identities=13% Similarity=0.131 Sum_probs=84.5
Q ss_pred ceeEEEEcCCCCEEEEEe---CCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEE-cCCCeee
Q 040274 69 RTDLMRVNPFNGVVSLGH---SGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWD-LRKYEVL 144 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~---~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd-~~~~~~~ 144 (359)
.+.+.++++++..++... ....+.++... .....+. ....+...+|++++...+....+....++. ...+...
T Consensus 25 ~~~s~AvS~dg~~~A~v~~~~~~~~L~~~~~~--~~~~~~~-~g~~l~~PS~d~~g~~W~v~~~~~~~~~~~~~~~g~~~ 101 (253)
T PF10647_consen 25 DVTSPAVSPDGSRVAAVSEGDGGRSLYVGPAG--GPVRPVL-TGGSLTRPSWDPDGWVWTVDDGSGGVRVVRDSASGTGE 101 (253)
T ss_pred cccceEECCCCCeEEEEEEcCCCCEEEEEcCC--Ccceeec-cCCccccccccCCCCEEEEEcCCCceEEEEecCCCcce
Confidence 578888999888776655 22345555433 3333322 233788899999988777766666666663 3333321
Q ss_pred E-ee-----cCCceeEEEcCCC--cEEEE---cCCcEEEEcCCCCCcc-cc----ccccccCCCCcceeEEEEccCCCEE
Q 040274 145 Q-TL-----TGHAKTLDFSQKG--LLAVG---TGSFAQILGDFSGSHN-YS----RYMGNSMVKGYQIGKVSFRPYEDVL 208 (359)
Q Consensus 145 ~-~~-----~~~v~~~~~s~~g--l~~~~---~d~~i~v~d~~~~~~~-~~----~~~~~~~~~~~~v~~~~~sp~~~~l 208 (359)
. .. .+.|+.+.+|||| ++... .++.|.|--+.....- .. .+.... .....+..+.|.+++.++
T Consensus 102 ~~~v~~~~~~~~I~~l~vSpDG~RvA~v~~~~~~~~v~va~V~r~~~g~~~~l~~~~~~~~-~~~~~v~~v~W~~~~~L~ 180 (253)
T PF10647_consen 102 PVEVDWPGLRGRITALRVSPDGTRVAVVVEDGGGGRVYVAGVVRDGDGVPRRLTGPRRVAP-PLLSDVTDVAWSDDSTLV 180 (253)
T ss_pred eEEecccccCCceEEEEECCCCcEEEEEEecCCCCeEEEEEEEeCCCCCcceeccceEecc-cccCcceeeeecCCCEEE
Confidence 1 11 1279999999999 33333 2567766643322111 11 111000 023468999999999988
Q ss_pred EEEeCCCe
Q 040274 209 GIGHSMGW 216 (359)
Q Consensus 209 ~~g~~dg~ 216 (359)
+.+...+.
T Consensus 181 V~~~~~~~ 188 (253)
T PF10647_consen 181 VLGRSAGG 188 (253)
T ss_pred EEeCCCCC
Confidence 77766553
No 349
>KOG0882 consensus Cyclophilin-related peptidyl-prolyl cis-trans isomerase [Posttranslational modification, protein turnover, chaperones]
Probab=97.10 E-value=0.0069 Score=55.48 Aligned_cols=155 Identities=9% Similarity=-0.039 Sum_probs=101.1
Q ss_pred ceeEEEEcCCCCEEEEEeC-CCeEEEEeCCCCcceEEee--cCCCCeEEEEEecC-C--CEEEEecCCCeEEEEEcCCCe
Q 040274 69 RTDLMRVNPFNGVVSLGHS-GGTVTMWKPTTSALLIKML--YHQGPVSALAFHPN-G--HLMATTGKECKIKIWDLRKYE 142 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~-dg~v~lwd~~~~~~~~~~~--~h~~~v~~l~~~p~-g--~~l~s~~~d~~i~vwd~~~~~ 142 (359)
.|.+++.+-++.++.|++. |..++++|+.+-..+.-+. --.+.+.++. +|. . ..-++.-.++.+.++|-....
T Consensus 55 ~I~sl~~S~dg~L~~Sv~d~Dhs~KvfDvEn~DminmiKL~~lPg~a~wv~-skGd~~s~IAVs~~~sg~i~VvD~~~d~ 133 (558)
T KOG0882|consen 55 VILSLAVSYDGWLFRSVEDPDHSVKVFDVENFDMINMIKLVDLPGFAEWVT-SKGDKISLIAVSLFKSGKIFVVDGFGDF 133 (558)
T ss_pred HHHhhhccccceeEeeccCcccceeEEEeeccchhhhcccccCCCceEEec-CCCCeeeeEEeecccCCCcEEECCcCCc
Confidence 6777888889989999777 9999999987654432222 1223222221 221 1 223334457899999987644
Q ss_pred e-eEee----cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCcc----c--------cccccccCCCCcceeEEEEcc
Q 040274 143 V-LQTL----TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHN----Y--------SRYMGNSMVKGYQIGKVSFRP 203 (359)
Q Consensus 143 ~-~~~~----~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~----~--------~~~~~~~~~~~~~v~~~~~sp 203 (359)
+ ..-+ ..+|..+.++|.+ .++....|.|.-|.....-+. + ..|.... ......++.|+|
T Consensus 134 ~q~~~fkklH~sPV~~i~y~qa~Ds~vSiD~~gmVEyWs~e~~~qfPr~~l~~~~K~eTdLy~f~K--~Kt~pts~Efsp 211 (558)
T KOG0882|consen 134 CQDGYFKKLHFSPVKKIRYNQAGDSAVSIDISGMVEYWSAEGPFQFPRTNLNFELKHETDLYGFPK--AKTEPTSFEFSP 211 (558)
T ss_pred CccceecccccCceEEEEeeccccceeeccccceeEeecCCCcccCccccccccccccchhhcccc--cccCccceEEcc
Confidence 2 2222 4678999999988 666777899999985421000 0 0111111 223578999999
Q ss_pred CCCEEEEEeCCCeEEEEEcCCCC
Q 040274 204 YEDVLGIGHSMGWSGILVPRSSE 226 (359)
Q Consensus 204 ~~~~l~~g~~dg~~~i~~~gs~~ 226 (359)
+|..+.+-+.|..+++++.-+++
T Consensus 212 ~g~qistl~~DrkVR~F~~KtGk 234 (558)
T KOG0882|consen 212 DGAQISTLNPDRKVRGFVFKTGK 234 (558)
T ss_pred ccCcccccCcccEEEEEEeccch
Confidence 99999999999999998887765
No 350
>PF14870 PSII_BNR: Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=97.08 E-value=0.18 Score=45.30 Aligned_cols=141 Identities=13% Similarity=0.218 Sum_probs=76.1
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEc-CCCeeeEe-
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDL-RKYEVLQT- 146 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~-~~~~~~~~- 146 (359)
.+..+..+++|.++++++.-....-||.-...-...-......|.++.|+|++.+.+.+ ..|.|++=+. ........
T Consensus 146 s~~~~~r~~dG~~vavs~~G~~~~s~~~G~~~w~~~~r~~~~riq~~gf~~~~~lw~~~-~Gg~~~~s~~~~~~~~w~~~ 224 (302)
T PF14870_consen 146 SINDITRSSDGRYVAVSSRGNFYSSWDPGQTTWQPHNRNSSRRIQSMGFSPDGNLWMLA-RGGQIQFSDDPDDGETWSEP 224 (302)
T ss_dssp -EEEEEE-TTS-EEEEETTSSEEEEE-TT-SS-EEEE--SSS-EEEEEE-TTS-EEEEE-TTTEEEEEE-TTEEEEE---
T ss_pred eeEeEEECCCCcEEEEECcccEEEEecCCCccceEEccCccceehhceecCCCCEEEEe-CCcEEEEccCCCCccccccc
Confidence 67888889999988888665566678865433333333456789999999998876654 7788887762 22222111
Q ss_pred ---e--cC-CceeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeC
Q 040274 147 ---L--TG-HAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHS 213 (359)
Q Consensus 147 ---~--~~-~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~ 213 (359)
+ .+ .+.+++|.+++ +.+++..|++.+=. .+++.......-.. ....++.+.|.+...-++.|..
T Consensus 225 ~~~~~~~~~~~ld~a~~~~~~~wa~gg~G~l~~S~--DgGktW~~~~~~~~-~~~n~~~i~f~~~~~gf~lG~~ 295 (302)
T PF14870_consen 225 IIPIKTNGYGILDLAYRPPNEIWAVGGSGTLLVST--DGGKTWQKDRVGEN-VPSNLYRIVFVNPDKGFVLGQD 295 (302)
T ss_dssp B-TTSS--S-EEEEEESSSS-EEEEESTT-EEEES--STTSS-EE-GGGTT-SSS---EEEEEETTEEEEE-ST
T ss_pred cCCcccCceeeEEEEecCCCCEEEEeCCccEEEeC--CCCccceECccccC-CCCceEEEEEcCCCceEEECCC
Confidence 1 12 26889999988 77788777665543 33344333322111 1225888899877666665543
No 351
>COG3391 Uncharacterized conserved protein [Function unknown]
Probab=97.07 E-value=0.082 Score=49.44 Aligned_cols=150 Identities=13% Similarity=0.147 Sum_probs=97.6
Q ss_pred eeEEEEcCCCC-EEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecC---CCeEEEEEcCCCeeeE
Q 040274 70 TDLMRVNPFNG-VVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGK---ECKIKIWDLRKYEVLQ 145 (359)
Q Consensus 70 v~~l~~sp~~~-~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~---d~~i~vwd~~~~~~~~ 145 (359)
-..++.++.+. .+++...+..|.+.|..+........... ....++++|++..+..+.. ++++.+.|..++..+.
T Consensus 76 p~~i~v~~~~~~vyv~~~~~~~v~vid~~~~~~~~~~~vG~-~P~~~~~~~~~~~vYV~n~~~~~~~vsvid~~t~~~~~ 154 (381)
T COG3391 76 PAGVAVNPAGNKVYVTTGDSNTVSVIDTATNTVLGSIPVGL-GPVGLAVDPDGKYVYVANAGNGNNTVSVIDAATNKVTA 154 (381)
T ss_pred ccceeeCCCCCeEEEecCCCCeEEEEcCcccceeeEeeecc-CCceEEECCCCCEEEEEecccCCceEEEEeCCCCeEEE
Confidence 34677888776 55555567899999988776666554322 4578999999987776655 6889999999888877
Q ss_pred eec-C-CceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC---CeE
Q 040274 146 TLT-G-HAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM---GWS 217 (359)
Q Consensus 146 ~~~-~-~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d---g~~ 217 (359)
+.+ + ....++++|+| +++-..++.|.++|.... .............+.....+.++|+|..+.+.... +.+
T Consensus 155 ~~~vG~~P~~~a~~p~g~~vyv~~~~~~~v~vi~~~~~-~v~~~~~~~~~~~~~~P~~i~v~~~g~~~yV~~~~~~~~~v 233 (381)
T COG3391 155 TIPVGNTPTGVAVDPDGNKVYVTNSDDNTVSVIDTSGN-SVVRGSVGSLVGVGTGPAGIAVDPDGNRVYVANDGSGSNNV 233 (381)
T ss_pred EEecCCCcceEEECCCCCeEEEEecCCCeEEEEeCCCc-ceeccccccccccCCCCceEEECCCCCEEEEEeccCCCceE
Confidence 762 2 24889999999 334445789999994333 22210000000022245778999999866655444 344
Q ss_pred EEEE
Q 040274 218 GILV 221 (359)
Q Consensus 218 ~i~~ 221 (359)
..+.
T Consensus 234 ~~id 237 (381)
T COG3391 234 LKID 237 (381)
T ss_pred EEEe
Confidence 4443
No 352
>PF00780 CNH: CNH domain; InterPro: IPR001180 Based on sequence similarities a domain of homology has been identified in the following proteins []: Citron and Citron kinase. These two proteins interact with the GTP-bound forms of the small GTPases Rho and Rac but not with Cdc42. Myotonic dystrophy kinase-related Cdc42-binding kinase (MRCKalpha). This serine/threonine kinase interacts with the GTP-bound form of the small GTPase Cdc42 and to a lesser extent with that of Rac. NCK Interacting Kinase (NIK), a serine/threonine protein kinase. ROM-1 and ROM-2, from yeast. These proteins are GDP/GTP exchange proteins (GEPs) for the small GTP binding protein Rho1. This domain, called the citron homology domain, is often found after cysteine rich and pleckstrin homology (PH) domains at the C-terminal end of the proteins []. It acts as a regulatory domain and could be involved in macromolecular interactions [, ].; GO: 0005083 small GTPase regulator activity
Probab=97.05 E-value=0.03 Score=49.70 Aligned_cols=136 Identities=14% Similarity=0.219 Sum_probs=83.8
Q ss_pred CCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeE-----------
Q 040274 77 PFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQ----------- 145 (359)
Q Consensus 77 p~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~----------- 145 (359)
..++.|+.|..+| |.+|+.........+ .+...|..+...|+-+.|++-+ |+.++++|+.......
T Consensus 5 ~~~~~L~vGt~~G-l~~~~~~~~~~~~~i-~~~~~I~ql~vl~~~~~llvLs-d~~l~~~~L~~l~~~~~~~~~~~~~~~ 81 (275)
T PF00780_consen 5 SWGDRLLVGTEDG-LYVYDLSDPSKPTRI-LKLSSITQLSVLPELNLLLVLS-DGQLYVYDLDSLEPVSTSAPLAFPKSR 81 (275)
T ss_pred cCCCEEEEEECCC-EEEEEecCCccceeE-eecceEEEEEEecccCEEEEEc-CCccEEEEchhhccccccccccccccc
Confidence 4678999998888 899998322222222 2344499999999877776664 4999999987644332
Q ss_pred ----eec--CCceeEE--EcCCC--cEEEEcCCcEEEEcCCCCCccc-cccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 146 ----TLT--GHAKTLD--FSQKG--LLAVGTGSFAQILGDFSGSHNY-SRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 146 ----~~~--~~v~~~~--~s~~g--l~~~~~d~~i~v~d~~~~~~~~-~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
.+. ..+..++ -...+ .+++.....|.+|......... ..+..... ...+.++.|. ++.|++|..+
T Consensus 82 ~~~~~~~~~~~v~~f~~~~~~~~~~~L~va~kk~i~i~~~~~~~~~f~~~~ke~~l--p~~~~~i~~~--~~~i~v~~~~ 157 (275)
T PF00780_consen 82 SLPTKLPETKGVSFFAVNGGHEGSRRLCVAVKKKILIYEWNDPRNSFSKLLKEISL--PDPPSSIAFL--GNKICVGTSK 157 (275)
T ss_pred cccccccccCCeeEEeeccccccceEEEEEECCEEEEEEEECCcccccceeEEEEc--CCCcEEEEEe--CCEEEEEeCC
Confidence 121 2233333 11233 6667777789988765432222 22222221 1368899998 6788888888
Q ss_pred CeEEE
Q 040274 215 GWSGI 219 (359)
Q Consensus 215 g~~~i 219 (359)
++..+
T Consensus 158 ~f~~i 162 (275)
T PF00780_consen 158 GFYLI 162 (275)
T ss_pred ceEEE
Confidence 76544
No 353
>PF12234 Rav1p_C: RAVE protein 1 C terminal; InterPro: IPR022033 This domain family is found in eukaryotes, and is typically between 621 and 644 amino acids in length. This family is the C-terminal region of the protein RAVE (regulator of the ATPase of vacuolar and endosomal membranes). Rav1p is involved in regulating the glucose dependent assembly and disassembly of vacuolar ATPase V1 and V0 subunits.
Probab=97.01 E-value=0.015 Score=56.93 Aligned_cols=106 Identities=14% Similarity=0.331 Sum_probs=73.6
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee-cCCCCeEEEEEe--cCCCEEEEecCCCeEEEEEc-----C-
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML-YHQGPVSALAFH--PNGHLMATTGKECKIKIWDL-----R- 139 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~-~h~~~v~~l~~~--p~g~~l~s~~~d~~i~vwd~-----~- 139 (359)
.++-+.-|.-++..++-+....+.|||...+.....-. ...+.|.++.|. |+|..+++.|-.+.|.+|-- .
T Consensus 31 ~~~li~gss~~k~a~V~~~~~~LtIWD~~~~~lE~~~~f~~~~~I~dLDWtst~d~qsiLaVGf~~~v~l~~Q~R~dy~~ 110 (631)
T PF12234_consen 31 NPSLISGSSIKKIAVVDSSRSELTIWDTRSGVLEYEESFSEDDPIRDLDWTSTPDGQSILAVGFPHHVLLYTQLRYDYTN 110 (631)
T ss_pred CcceEeecccCcEEEEECCCCEEEEEEcCCcEEEEeeeecCCCceeeceeeecCCCCEEEEEEcCcEEEEEEccchhhhc
Confidence 34444444444444444445579999999876443322 457889999994 68999999999999999843 1
Q ss_pred ---CCeeeEee------cCCceeEEEcCCCcEEEEcCCcEEEEc
Q 040274 140 ---KYEVLQTL------TGHAKTLDFSQKGLLAVGTGSFAQILG 174 (359)
Q Consensus 140 ---~~~~~~~~------~~~v~~~~~s~~gl~~~~~d~~i~v~d 174 (359)
+..++..+ +.+|.+..|.++|.+.++.++.+.|||
T Consensus 111 ~~p~w~~i~~i~i~~~T~h~Igds~Wl~~G~LvV~sGNqlfv~d 154 (631)
T PF12234_consen 111 KGPSWAPIRKIDISSHTPHPIGDSIWLKDGTLVVGSGNQLFVFD 154 (631)
T ss_pred CCcccceeEEEEeecCCCCCccceeEecCCeEEEEeCCEEEEEC
Confidence 12334444 356899999999977777788999998
No 354
>PF04841 Vps16_N: Vps16, N-terminal region; InterPro: IPR006926 This protein forms part of the Class C vacuolar protein sorting (Vps) complex. Vps16 is essential for vacuolar protein sorting, which is essential for viability in plants, but not yeast []. The Class C Vps complex is required for SNARE-mediated membrane fusion at the lysosome-like yeast vacuole. It is thought to play essential roles in membrane docking and fusion at the Golgi-to-endosome and endosome-to-vacuole stages of transport []. The role of VPS16 in this complex is not known.; GO: 0006886 intracellular protein transport, 0005737 cytoplasm
Probab=96.96 E-value=0.12 Score=48.78 Aligned_cols=48 Identities=10% Similarity=0.430 Sum_probs=38.3
Q ss_pred eEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcC
Q 040274 90 TVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLR 139 (359)
Q Consensus 90 ~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~ 139 (359)
.|.+|+.. |..+.++....+.+.++.|+.+.. |++...||.+++||+.
T Consensus 62 ~I~iys~s-G~ll~~i~w~~~~iv~~~wt~~e~-LvvV~~dG~v~vy~~~ 109 (410)
T PF04841_consen 62 SIQIYSSS-GKLLSSIPWDSGRIVGMGWTDDEE-LVVVQSDGTVRVYDLF 109 (410)
T ss_pred EEEEECCC-CCEeEEEEECCCCEEEEEECCCCe-EEEEEcCCEEEEEeCC
Confidence 59999865 677777665558999999988654 5566799999999986
No 355
>COG3386 Gluconolactonase [Carbohydrate transport and metabolism]
Probab=96.95 E-value=0.12 Score=46.65 Aligned_cols=137 Identities=15% Similarity=0.105 Sum_probs=82.1
Q ss_pred ceeEEEEcCCCCEEEEEeC-----------CCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCC-CeEEEE
Q 040274 69 RTDLMRVNPFNGVVSLGHS-----------GGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKE-CKIKIW 136 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~-----------dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d-~~i~vw 136 (359)
..+.+...|+|.+-++... -|.|+.+|+ .+..+..+..|-..-++|+||||++.|+.+... +.|..|
T Consensus 112 r~ND~~v~pdG~~wfgt~~~~~~~~~~~~~~G~lyr~~p-~g~~~~l~~~~~~~~NGla~SpDg~tly~aDT~~~~i~r~ 190 (307)
T COG3386 112 RPNDGVVDPDGRIWFGDMGYFDLGKSEERPTGSLYRVDP-DGGVVRLLDDDLTIPNGLAFSPDGKTLYVADTPANRIHRY 190 (307)
T ss_pred CCCceeEcCCCCEEEeCCCccccCccccCCcceEEEEcC-CCCEEEeecCcEEecCceEECCCCCEEEEEeCCCCeEEEE
Confidence 5667777888765554333 144555555 455555555656667899999999888777664 778888
Q ss_pred EcCC--Ce---e--eEee---cCCceeEEEcCCC-cEEEE-cCC-cEEEEcCCCCCccccccccccCCCCcceeEEEEcc
Q 040274 137 DLRK--YE---V--LQTL---TGHAKTLDFSQKG-LLAVG-TGS-FAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRP 203 (359)
Q Consensus 137 d~~~--~~---~--~~~~---~~~v~~~~~s~~g-l~~~~-~d~-~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp 203 (359)
++.. +. . ...+ ++..-.++...+| +.++. .+| .|.+|+.. +.....+..+. ..+++++|--
T Consensus 191 ~~d~~~g~~~~~~~~~~~~~~~G~PDG~~vDadG~lw~~a~~~g~~v~~~~pd--G~l~~~i~lP~----~~~t~~~FgG 264 (307)
T COG3386 191 DLDPATGPIGGRRGFVDFDEEPGLPDGMAVDADGNLWVAAVWGGGRVVRFNPD--GKLLGEIKLPV----KRPTNPAFGG 264 (307)
T ss_pred ecCcccCccCCcceEEEccCCCCCCCceEEeCCCCEEEecccCCceEEEECCC--CcEEEEEECCC----CCCccceEeC
Confidence 7752 11 1 1111 3445667777888 55333 333 89999843 34554444432 2577777753
Q ss_pred -CCCEEEEEe
Q 040274 204 -YEDVLGIGH 212 (359)
Q Consensus 204 -~~~~l~~g~ 212 (359)
+.+.|.+.+
T Consensus 265 ~~~~~L~iTs 274 (307)
T COG3386 265 PDLNTLYITS 274 (307)
T ss_pred CCcCEEEEEe
Confidence 445554433
No 356
>PF06977 SdiA-regulated: SdiA-regulated; InterPro: IPR009722 This entry represents a conserved region approximately 100 residues long within a number of hypothetical bacterial proteins that may be regulated by SdiA, a member of the LuxR family of transcriptional regulators []. Some proteins contain the IPR001258 from INTERPRO repeat.; PDB: 3QQZ_A.
Probab=96.94 E-value=0.087 Score=45.89 Aligned_cols=157 Identities=9% Similarity=0.018 Sum_probs=81.2
Q ss_pred eEEEECCCCCEEEEecc------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCc---c---
Q 040274 52 ILWILPSSGRYMAVAGR------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSA---L--- 101 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~---~--- 101 (359)
..|+|.|+...|++... ..-.+++..++.++++--.++.+.++++.... .
T Consensus 25 SGLTy~pd~~tLfaV~d~~~~i~els~~G~vlr~i~l~g~~D~EgI~y~g~~~~vl~~Er~~~L~~~~~~~~~~~~~~~~ 104 (248)
T PF06977_consen 25 SGLTYNPDTGTLFAVQDEPGEIYELSLDGKVLRRIPLDGFGDYEGITYLGNGRYVLSEERDQRLYIFTIDDDTTSLDRAD 104 (248)
T ss_dssp EEEEEETTTTEEEEEETTTTEEEEEETT--EEEEEE-SS-SSEEEEEE-STTEEEEEETTTTEEEEEEE----TT--EEE
T ss_pred cccEEcCCCCeEEEEECCCCEEEEEcCCCCEEEEEeCCCCCCceeEEEECCCEEEEEEcCCCcEEEEEEeccccccchhh
Confidence 78899998666655444 45666666666555555568888888874321 1
Q ss_pred eEEee-----cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC---CeeeEee-----------cCCceeEEEcCCC--
Q 040274 102 LIKML-----YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRK---YEVLQTL-----------TGHAKTLDFSQKG-- 160 (359)
Q Consensus 102 ~~~~~-----~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~---~~~~~~~-----------~~~v~~~~~s~~g-- 160 (359)
...+. .+...+-.++|+|.+..|+.+-...-..+|.+.. ...+... ...++++.++|..
T Consensus 105 ~~~~~l~~~~~~N~G~EGla~D~~~~~L~v~kE~~P~~l~~~~~~~~~~~~~~~~~~~~~~~~~~~~d~S~l~~~p~t~~ 184 (248)
T PF06977_consen 105 VQKISLGFPNKGNKGFEGLAYDPKTNRLFVAKERKPKRLYEVNGFPGGFDLFVSDDQDLDDDKLFVRDLSGLSYDPRTGH 184 (248)
T ss_dssp EEEEE---S---SS--EEEEEETTTTEEEEEEESSSEEEEEEESTT-SS--EEEE-HHHH-HT--SS---EEEEETTTTE
T ss_pred ceEEecccccCCCcceEEEEEcCCCCEEEEEeCCCChhhEEEccccCccceeeccccccccccceeccccceEEcCCCCe
Confidence 11121 2445689999999877777776665555555543 1111111 1236889999975
Q ss_pred c-EEEEcCCcEEEEcCCCCCccccccccccCC-----CCcceeEEEEccCCCEEEE
Q 040274 161 L-LAVGTGSFAQILGDFSGSHNYSRYMGNSMV-----KGYQIGKVSFRPYEDVLGI 210 (359)
Q Consensus 161 l-~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~-----~~~~v~~~~~sp~~~~l~~ 210 (359)
+ +.+..+..|..+| ..+ .....+.-..+. .-.+.-.|+|.++|++.++
T Consensus 185 lliLS~es~~l~~~d-~~G-~~~~~~~L~~g~~gl~~~~~QpEGIa~d~~G~LYIv 238 (248)
T PF06977_consen 185 LLILSDESRLLLELD-RQG-RVVSSLSLDRGFHGLSKDIPQPEGIAFDPDGNLYIV 238 (248)
T ss_dssp EEEEETTTTEEEEE--TT---EEEEEE-STTGGG-SS---SEEEEEE-TT--EEEE
T ss_pred EEEEECCCCeEEEEC-CCC-CEEEEEEeCCcccCcccccCCccEEEECCCCCEEEE
Confidence 4 4444567788888 443 332222111100 1135788999999865444
No 357
>PF03178 CPSF_A: CPSF A subunit region; InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=96.92 E-value=0.078 Score=48.32 Aligned_cols=139 Identities=17% Similarity=0.190 Sum_probs=82.4
Q ss_pred CCEEEEEeC---------C-CeEEEEeCCCC----cceEEe--ecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCe
Q 040274 79 NGVVSLGHS---------G-GTVTMWKPTTS----ALLIKM--LYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYE 142 (359)
Q Consensus 79 ~~~l~tg~~---------d-g~v~lwd~~~~----~~~~~~--~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~ 142 (359)
..+|++|.. . |.|.++++... ..+..+ ....++|++++-. ++.++++. .+.|.+|++...+
T Consensus 42 ~~~ivVGT~~~~~~~~~~~~Gri~v~~i~~~~~~~~~l~~i~~~~~~g~V~ai~~~-~~~lv~~~--g~~l~v~~l~~~~ 118 (321)
T PF03178_consen 42 KEYIVVGTAFNYGEDPEPSSGRILVFEISESPENNFKLKLIHSTEVKGPVTAICSF-NGRLVVAV--GNKLYVYDLDNSK 118 (321)
T ss_dssp SEEEEEEEEE--TTSSS-S-EEEEEEEECSS-----EEEEEEEEEESS-EEEEEEE-TTEEEEEE--TTEEEEEEEETTS
T ss_pred cCEEEEEecccccccccccCcEEEEEEEEcccccceEEEEEEEEeecCcceEhhhh-CCEEEEee--cCEEEEEEccCcc
Confidence 457777653 2 88999999874 122222 2457889999876 44444443 3789999998766
Q ss_pred -eeEe--ec--CCceeEEEcCCCcEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeE
Q 040274 143 -VLQT--LT--GHAKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWS 217 (359)
Q Consensus 143 -~~~~--~~--~~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~ 217 (359)
.+.. +. ..++++....+-++++.....+.++...........+.... ....++++.|.++++.++++..+|.+
T Consensus 119 ~l~~~~~~~~~~~i~sl~~~~~~I~vgD~~~sv~~~~~~~~~~~l~~va~d~--~~~~v~~~~~l~d~~~~i~~D~~gnl 196 (321)
T PF03178_consen 119 TLLKKAFYDSPFYITSLSVFKNYILVGDAMKSVSLLRYDEENNKLILVARDY--QPRWVTAAEFLVDEDTIIVGDKDGNL 196 (321)
T ss_dssp SEEEEEEE-BSSSEEEEEEETTEEEEEESSSSEEEEEEETTTE-EEEEEEES--S-BEEEEEEEE-SSSEEEEEETTSEE
T ss_pred cchhhheecceEEEEEEeccccEEEEEEcccCEEEEEEEccCCEEEEEEecC--CCccEEEEEEecCCcEEEEEcCCCeE
Confidence 3322 22 34566665544366666667777664222222222222211 23368999999777899999999988
Q ss_pred EEEEc
Q 040274 218 GILVP 222 (359)
Q Consensus 218 ~i~~~ 222 (359)
.++-.
T Consensus 197 ~~l~~ 201 (321)
T PF03178_consen 197 FVLRY 201 (321)
T ss_dssp EEEEE
T ss_pred EEEEE
Confidence 77643
No 358
>PF06433 Me-amine-dh_H: Methylamine dehydrogenase heavy chain (MADH); InterPro: IPR009451 Methylamine dehydrogenase (1.4.99.3 from EC) is a periplasmic quinoprotein found in several methyltrophic bacteria []. It is induced when grown on methylamine as a carbon source MADH and catalyses the oxidative deamination of amines to their corresponding aldehydes. The redox cofactor of this enzyme is tryptophan tryptophylquinone (TTQ). Electrons derived from the oxidation of methylamine are passed to an electron acceptor, which is usually the blue-copper protein amicyanin (IPR002386 from INTERPRO). RCH2NH2 + H2O + acceptor = RCHO + NH3 + reduced acceptor MADH is a hetero-tetramer, comprised of two heavy subunits and two light subunits. The heavy subunit forms a seven-bladed beta-propeller like structure [].; GO: 0030058 amine dehydrogenase activity, 0030416 methylamine metabolic process, 0055114 oxidation-reduction process, 0042597 periplasmic space; PDB: 3RN1_F 3SVW_F 3PXT_F 3L4O_F 3L4M_D 3SJL_F 3PXS_D 3ORV_F 3RMZ_F 3RLM_F ....
Probab=96.88 E-value=0.15 Score=45.99 Aligned_cols=157 Identities=8% Similarity=-0.006 Sum_probs=90.5
Q ss_pred eeEEEEcCCCCEEEEEe----------CCCeEEEEeCCCCcceEEeecCC-------CCeEEEEEecCCCEEEEecC--C
Q 040274 70 TDLMRVNPFNGVVSLGH----------SGGTVTMWKPTTSALLIKMLYHQ-------GPVSALAFHPNGHLMATTGK--E 130 (359)
Q Consensus 70 v~~l~~sp~~~~l~tg~----------~dg~v~lwd~~~~~~~~~~~~h~-------~~v~~l~~~p~g~~l~s~~~--d 130 (359)
...+..+|+++.+++++ ..-.|.+||..|-.+...+.-.. ...+.++++.||++++.... .
T Consensus 38 ~~~~~~spdgk~~y~a~T~~sR~~rG~RtDvv~~~D~~TL~~~~EI~iP~k~R~~~~~~~~~~~ls~dgk~~~V~N~TPa 117 (342)
T PF06433_consen 38 LGNVALSPDGKTIYVAETFYSRGTRGERTDVVEIWDTQTLSPTGEIEIPPKPRAQVVPYKNMFALSADGKFLYVQNFTPA 117 (342)
T ss_dssp SEEEEE-TTSSEEEEEEEEEEETTEEEEEEEEEEEETTTTEEEEEEEETTS-B--BS--GGGEEE-TTSSEEEEEEESSS
T ss_pred CCceeECCCCCEEEEEEEEEeccccccceeEEEEEecCcCcccceEecCCcchheecccccceEEccCCcEEEEEccCCC
Confidence 44566789988887654 23469999999987766543221 12244677888888776543 4
Q ss_pred CeEEEEEcCCCeeeEeecCC--ceeEEEcCCCcEEEEcCCcEEEEcCCCCCccccccccccCC-CCcceeEEEEccCCCE
Q 040274 131 CKIKIWDLRKYEVLQTLTGH--AKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYMGNSMV-KGYQIGKVSFRPYEDV 207 (359)
Q Consensus 131 ~~i~vwd~~~~~~~~~~~~~--v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~-~~~~v~~~~~sp~~~~ 207 (359)
..|.|-|+...+.+.++.-+ ..-.-+.++++.+.|.||.+..+.+...++........... ....+..-.++..+..
T Consensus 118 ~SVtVVDl~~~kvv~ei~~PGC~~iyP~~~~~F~~lC~DGsl~~v~Ld~~Gk~~~~~t~~F~~~~dp~f~~~~~~~~~~~ 197 (342)
T PF06433_consen 118 TSVTVVDLAAKKVVGEIDTPGCWLIYPSGNRGFSMLCGDGSLLTVTLDADGKEAQKSTKVFDPDDDPLFEHPAYSRDGGR 197 (342)
T ss_dssp EEEEEEETTTTEEEEEEEGTSEEEEEEEETTEEEEEETTSCEEEEEETSTSSEEEEEEEESSTTTS-B-S--EEETTTTE
T ss_pred CeEEEEECCCCceeeeecCCCEEEEEecCCCceEEEecCCceEEEEECCCCCEeEeeccccCCCCcccccccceECCCCe
Confidence 56888999988888888433 22222233448888888888777655444333211110000 1112234455556666
Q ss_pred EEEEeCCCeEEEEEcCCCC
Q 040274 208 LGIGHSMGWSGILVPRSSE 226 (359)
Q Consensus 208 l~~g~~dg~~~i~~~gs~~ 226 (359)
++.-+.+|.+.-..-+...
T Consensus 198 ~~F~Sy~G~v~~~dlsg~~ 216 (342)
T PF06433_consen 198 LYFVSYEGNVYSADLSGDS 216 (342)
T ss_dssp EEEEBTTSEEEEEEETTSS
T ss_pred EEEEecCCEEEEEeccCCc
Confidence 7777788877665544433
No 359
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=96.86 E-value=0.034 Score=52.25 Aligned_cols=139 Identities=16% Similarity=0.205 Sum_probs=83.5
Q ss_pred CEEEEEeCCCeEEEEeCCCCcceEEeecCCC-------CeEEEEEec--CCCEEEEecCCCeEEEEEcCCCeeeEeec-C
Q 040274 80 GVVSLGHSGGTVTMWKPTTSALLIKMLYHQG-------PVSALAFHP--NGHLMATTGKECKIKIWDLRKYEVLQTLT-G 149 (359)
Q Consensus 80 ~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~-------~v~~l~~~p--~g~~l~s~~~d~~i~vwd~~~~~~~~~~~-~ 149 (359)
..++.++.+|.+..+|+.+|+.+........ ....+..+| .+..++.++.++.+..+|+.+|+.+.... +
T Consensus 206 ~~v~~~~~~g~v~a~d~~~G~~~W~~~~~~~~~~~~~~~~~~~~~sP~v~~~~vy~~~~~g~l~ald~~tG~~~W~~~~~ 285 (394)
T PRK11138 206 GGAIVGGDNGRVSAVLMEQGQLIWQQRISQPTGATEIDRLVDVDTTPVVVGGVVYALAYNGNLVALDLRSGQIVWKREYG 285 (394)
T ss_pred CEEEEEcCCCEEEEEEccCChhhheeccccCCCccchhcccccCCCcEEECCEEEEEEcCCeEEEEECCCCCEEEeecCC
Confidence 3566777889999999998887665431110 011111122 24567777789999999999998776652 2
Q ss_pred CceeEEEcCCC-cEEEEcCCcEEEEcCCCCCcccccc-ccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCC
Q 040274 150 HAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRY-MGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSE 226 (359)
Q Consensus 150 ~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~-~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~ 226 (359)
....+... ++ ++.++.++.+..+|..++......- .... ...+... .+..|++++.+|.+.++...+++
T Consensus 286 ~~~~~~~~-~~~vy~~~~~g~l~ald~~tG~~~W~~~~~~~~-----~~~sp~v--~~g~l~v~~~~G~l~~ld~~tG~ 356 (394)
T PRK11138 286 SVNDFAVD-GGRIYLVDQNDRVYALDTRGGVELWSQSDLLHR-----LLTAPVL--YNGYLVVGDSEGYLHWINREDGR 356 (394)
T ss_pred CccCcEEE-CCEEEEEcCCCeEEEEECCCCcEEEcccccCCC-----cccCCEE--ECCEEEEEeCCCEEEEEECCCCC
Confidence 22223332 33 7777888999999965553222111 1111 1222222 35678889999988887766553
No 360
>PF08596 Lgl_C: Lethal giant larvae(Lgl) like, C-terminal; InterPro: IPR013905 The Lethal giant larvae (Lgl) tumour suppressor protein is conserved from yeast to mammals. The Lgl protein functions in cell polarity, at least in part, by regulating SNARE-mediated membrane delivery events at the cell surface []. The N-terminal half of Lgl members contains WD40 repeats (see IPR001680 from INTERPRO), while the C-terminal half appears specific to the protein []. ; PDB: 2OAJ_A.
Probab=96.82 E-value=0.036 Score=51.83 Aligned_cols=107 Identities=21% Similarity=0.221 Sum_probs=70.5
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCC-------------------------------------------cceEEe
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTS-------------------------------------------ALLIKM 105 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~-------------------------------------------~~~~~~ 105 (359)
.|+.+.|+++..-|++|...|.|-||..... .+...+
T Consensus 3 ~v~~vs~a~~t~Elav~~~~GeVv~~k~~~n~~~~~~~~~~~~~~~~~~~~~~~~~~~l~di~~r~~~~~~~gf~P~~l~ 82 (395)
T PF08596_consen 3 SVTHVSFAPETLELAVGLESGEVVLFKFGKNQNYGNREQPPDLDYNFRRFSLNNSPGKLTDISDRAPPSLKEGFLPLTLL 82 (395)
T ss_dssp -EEEEEEETTTTEEEEEETTS-EEEEEEEE------------------S--GGGSS-SEEE-GGG--TT-SEEEEEEEEE
T ss_pred eEEEEEecCCCceEEEEccCCcEEEEEcccCCCCCccCCCcccCcccccccccCCCcceEEehhhCCcccccccCchhhe
Confidence 3677888887777888888887777643110 122233
Q ss_pred ecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee--c---------CCceeEEEc-----CCC-----cEEE
Q 040274 106 LYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL--T---------GHAKTLDFS-----QKG-----LLAV 164 (359)
Q Consensus 106 ~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~---------~~v~~~~~s-----~~g-----l~~~ 164 (359)
....++|++++.|.- -+++.|..+|.+.|.|+|....++.- . ..++++.|+ .|+ ++++
T Consensus 83 ~~~~g~vtal~~S~i-GFvaigy~~G~l~viD~RGPavI~~~~i~~~~~~~~~~~~vt~ieF~vm~~~~D~ySSi~L~vG 161 (395)
T PF08596_consen 83 DAKQGPVTALKNSDI-GFVAIGYESGSLVVIDLRGPAVIYNENIRESFLSKSSSSYVTSIEFSVMTLGGDGYSSICLLVG 161 (395)
T ss_dssp ---S-SEEEEEE-BT-SEEEEEETTSEEEEEETTTTEEEEEEEGGG--T-SS----EEEEEEEEEE-TTSSSEEEEEEEE
T ss_pred eccCCcEeEEecCCC-cEEEEEecCCcEEEEECCCCeEEeeccccccccccccccCeeEEEEEEEecCCCcccceEEEEE
Confidence 345789999998754 48999999999999999988776653 1 236677775 233 6677
Q ss_pred EcCCcEEEEcCC
Q 040274 165 GTGSFAQILGDF 176 (359)
Q Consensus 165 ~~d~~i~v~d~~ 176 (359)
...|.+.+|.+.
T Consensus 162 Tn~G~v~~fkIl 173 (395)
T PF08596_consen 162 TNSGNVLTFKIL 173 (395)
T ss_dssp ETTSEEEEEEEE
T ss_pred eCCCCEEEEEEe
Confidence 778999999764
No 361
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=96.80 E-value=0.03 Score=52.61 Aligned_cols=101 Identities=17% Similarity=0.100 Sum_probs=66.6
Q ss_pred CCCEEEEEeCCCeEEEEeCCCCcceEEeecCCC--CeE-----EEEEec--CCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 78 FNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQG--PVS-----ALAFHP--NGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 78 ~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~--~v~-----~l~~~p--~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
.+..+++++.+|.|.-+|..+|+.+........ .+. .+.-.| ++..++.++.++.++.+|..+|+.+....
T Consensus 68 ~~~~vy~~~~~g~l~ald~~tG~~~W~~~~~~~~~~~~~~~~~~~~~~~~v~~~~v~v~~~~g~l~ald~~tG~~~W~~~ 147 (394)
T PRK11138 68 AYNKVYAADRAGLVKALDADTGKEIWSVDLSEKDGWFSKNKSALLSGGVTVAGGKVYIGSEKGQVYALNAEDGEVAWQTK 147 (394)
T ss_pred ECCEEEEECCCCeEEEEECCCCcEeeEEcCCCcccccccccccccccccEEECCEEEEEcCCCEEEEEECCCCCCccccc
Confidence 456788888899999999999988877643220 000 000111 34567778889999999999999887763
Q ss_pred --CCce-eEEEcCCC-cEEEEcCCcEEEEcCCCCC
Q 040274 149 --GHAK-TLDFSQKG-LLAVGTGSFAQILGDFSGS 179 (359)
Q Consensus 149 --~~v~-~~~~s~~g-l~~~~~d~~i~v~d~~~~~ 179 (359)
+.+. +.... ++ ++.++.++.|..+|..++.
T Consensus 148 ~~~~~~ssP~v~-~~~v~v~~~~g~l~ald~~tG~ 181 (394)
T PRK11138 148 VAGEALSRPVVS-DGLVLVHTSNGMLQALNESDGA 181 (394)
T ss_pred CCCceecCCEEE-CCEEEEECCCCEEEEEEccCCC
Confidence 3222 12222 45 6666778889999966653
No 362
>PF12894 Apc4_WD40: Anaphase-promoting complex subunit 4 WD40 domain
Probab=96.79 E-value=0.0039 Score=38.89 Aligned_cols=32 Identities=22% Similarity=0.343 Sum_probs=28.7
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcc
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSAL 101 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~ 101 (359)
.|.+++|+|...+||.|+.+|.|.+|.+ +++.
T Consensus 13 ~v~~~~w~P~mdLiA~~t~~g~v~v~Rl-~~qr 44 (47)
T PF12894_consen 13 RVSCMSWCPTMDLIALGTEDGEVLVYRL-NWQR 44 (47)
T ss_pred cEEEEEECCCCCEEEEEECCCeEEEEEC-CCcC
Confidence 5889999999999999999999999998 4544
No 363
>PF14583 Pectate_lyase22: Oligogalacturonate lyase; PDB: 3C5M_C 3PE7_A.
Probab=96.77 E-value=0.086 Score=48.41 Aligned_cols=157 Identities=13% Similarity=0.068 Sum_probs=85.0
Q ss_pred eEEEECCCCCEEEEecc--------------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEe
Q 040274 52 ILWILPSSGRYMAVAGR--------------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKM 105 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~--------------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~ 105 (359)
+.=+|.+||+.|+.++. ......++|++..++....+..|...|+.+.+....+
T Consensus 39 ~~~~ft~dG~kllF~s~~dg~~nly~lDL~t~~i~QLTdg~g~~~~g~~~s~~~~~~~Yv~~~~~l~~vdL~T~e~~~vy 118 (386)
T PF14583_consen 39 YQNCFTDDGRKLLFASDFDGNRNLYLLDLATGEITQLTDGPGDNTFGGFLSPDDRALYYVKNGRSLRRVDLDTLEERVVY 118 (386)
T ss_dssp TS--B-TTS-EEEEEE-TTSS-EEEEEETTT-EEEE---SS-B-TTT-EE-TTSSEEEEEETTTEEEEEETTT--EEEEE
T ss_pred cCCCcCCCCCEEEEEeccCCCcceEEEEcccCEEEECccCCCCCccceEEecCCCeEEEEECCCeEEEEECCcCcEEEEE
Confidence 44467899998888766 2334666787777776666678888899988765555
Q ss_pred ecCCCCeEEEEE--ecCCCEEEEecC----------------------CCeEEEEEcCCCeeeEee--cCCceeEEEcCC
Q 040274 106 LYHQGPVSALAF--HPNGHLMATTGK----------------------ECKIKIWDLRKYEVLQTL--TGHAKTLDFSQK 159 (359)
Q Consensus 106 ~~h~~~v~~l~~--~p~g~~l~s~~~----------------------d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~ 159 (359)
....+.+-...| +.++..++..-. .+.|..-|+.+|+....+ ...+.-+.|||.
T Consensus 119 ~~p~~~~g~gt~v~n~d~t~~~g~e~~~~d~~~l~~~~~f~e~~~a~p~~~i~~idl~tG~~~~v~~~~~wlgH~~fsP~ 198 (386)
T PF14583_consen 119 EVPDDWKGYGTWVANSDCTKLVGIEISREDWKPLTKWKGFREFYEARPHCRIFTIDLKTGERKVVFEDTDWLGHVQFSPT 198 (386)
T ss_dssp E--TTEEEEEEEEE-TTSSEEEEEEEEGGG-----SHHHHHHHHHC---EEEEEEETTT--EEEEEEESS-EEEEEEETT
T ss_pred ECCcccccccceeeCCCccEEEEEEEeehhccCccccHHHHHHHhhCCCceEEEEECCCCceeEEEecCccccCcccCCC
Confidence 555665555555 446666544311 134666678887764444 455788999998
Q ss_pred C--cEEEEcCC-----cEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEE
Q 040274 160 G--LLAVGTGS-----FAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGI 210 (359)
Q Consensus 160 g--l~~~~~d~-----~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~ 210 (359)
. +++-+..| .-+||-+...+.....+..+. .+..+..=-|.|||..|.-
T Consensus 199 dp~li~fCHEGpw~~Vd~RiW~i~~dg~~~~~v~~~~--~~e~~gHEfw~~DG~~i~y 254 (386)
T PF14583_consen 199 DPTLIMFCHEGPWDLVDQRIWTINTDGSNVKKVHRRM--EGESVGHEFWVPDGSTIWY 254 (386)
T ss_dssp EEEEEEEEE-S-TTTSS-SEEEEETTS---EESS-----TTEEEEEEEE-TTSS-EEE
T ss_pred CCCEEEEeccCCcceeceEEEEEEcCCCcceeeecCC--CCcccccccccCCCCEEEE
Confidence 7 66655432 236676555545555554442 3446777789999987654
No 364
>smart00320 WD40 WD40 repeats. Note that these repeats are permuted with respect to the structural repeats (blades) of the beta propeller domain.
Probab=96.71 E-value=0.0031 Score=36.12 Aligned_cols=27 Identities=15% Similarity=0.394 Sum_probs=25.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEe
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWK 95 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd 95 (359)
.|.++.|++.+.++++++.|+.|++|+
T Consensus 14 ~i~~~~~~~~~~~~~~~~~d~~~~~~~ 40 (40)
T smart00320 14 PVTSVAFSPDGKYLASASDDGTIKLWD 40 (40)
T ss_pred ceeEEEECCCCCEEEEecCCCeEEEcC
Confidence 689999999889999999999999996
No 365
>COG3204 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=96.70 E-value=0.21 Score=43.87 Aligned_cols=148 Identities=6% Similarity=0.070 Sum_probs=92.8
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeec-CCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEe-
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLY-HQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQT- 146 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~-h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~- 146 (359)
.++++.|+|+.+.|++..+.+.-.||=...|+.+.++.- .-...-++.|..+|.++++--.++.++++.+.....+..
T Consensus 87 nvS~LTynp~~rtLFav~n~p~~iVElt~~GdlirtiPL~g~~DpE~Ieyig~n~fvi~dER~~~l~~~~vd~~t~~~~~ 166 (316)
T COG3204 87 NVSSLTYNPDTRTLFAVTNKPAAIVELTKEGDLIRTIPLTGFSDPETIEYIGGNQFVIVDERDRALYLFTVDADTTVISA 166 (316)
T ss_pred cccceeeCCCcceEEEecCCCceEEEEecCCceEEEecccccCChhHeEEecCCEEEEEehhcceEEEEEEcCCccEEec
Confidence 789999999998888888777777777677888877652 122335677777888888877899999887765432211
Q ss_pred ----e--c---C---CceeEEEcCCC--cEEEEcCCcEEEEcCCCCCcccc--ccccccC---CCCcceeEEEEccCCC-
Q 040274 147 ----L--T---G---HAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYS--RYMGNSM---VKGYQIGKVSFRPYED- 206 (359)
Q Consensus 147 ----~--~---~---~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~--~~~~~~~---~~~~~v~~~~~sp~~~- 206 (359)
+ . . ..-.++|+|.. ++.+-.-+-+.||.+........ ....+.. ..-..|+++.|++..+
T Consensus 167 ~~~~i~L~~~~k~N~GfEGlA~d~~~~~l~~aKEr~P~~I~~~~~~~~~l~~~~~~~~~~~~~~f~~DvSgl~~~~~~~~ 246 (316)
T COG3204 167 KVQKIPLGTTNKKNKGFEGLAWDPVDHRLFVAKERNPIGIFEVTQSPSSLSVHASLDPTADRDLFVLDVSGLEFNAITNS 246 (316)
T ss_pred cceEEeccccCCCCcCceeeecCCCCceEEEEEccCCcEEEEEecCCcccccccccCcccccceEeeccccceecCCCCc
Confidence 1 1 1 13579999987 66666666666666433221111 1111110 0122578889997554
Q ss_pred EEEEEeCCCe
Q 040274 207 VLGIGHSMGW 216 (359)
Q Consensus 207 ~l~~g~~dg~ 216 (359)
.|+.+.+++.
T Consensus 247 LLVLS~ESr~ 256 (316)
T COG3204 247 LLVLSDESRR 256 (316)
T ss_pred EEEEecCCce
Confidence 4555555553
No 366
>KOG4640 consensus Anaphase-promoting complex (APC), subunit 4 [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=96.55 E-value=0.011 Score=56.41 Aligned_cols=90 Identities=21% Similarity=0.270 Sum_probs=66.5
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec---CCce-eEEEcCCC-cEEEE-cCCcEEEEcCCCCCccc
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT---GHAK-TLDFSQKG-LLAVG-TGSFAQILGDFSGSHNY 182 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~---~~v~-~~~~s~~g-l~~~~-~d~~i~v~d~~~~~~~~ 182 (359)
...+.-+.|+|.-.++|++..+|.|-+..+. .+.+.+++ -.++ +++|.||| +++++ .||+|.+.|+..+....
T Consensus 20 ~~~i~~~ewnP~~dLiA~~t~~gelli~R~n-~qRlwtip~p~~~v~~sL~W~~DGkllaVg~kdG~I~L~Dve~~~~l~ 98 (665)
T KOG4640|consen 20 PINIKRIEWNPKMDLIATRTEKGELLIHRLN-WQRLWTIPIPGENVTASLCWRPDGKLLAVGFKDGTIRLHDVEKGGRLV 98 (665)
T ss_pred ccceEEEEEcCccchhheeccCCcEEEEEec-cceeEeccCCCCccceeeeecCCCCEEEEEecCCeEEEEEccCCCcee
Confidence 3456778999999999999999999988887 66777774 2355 99999999 66666 68999999987664444
Q ss_pred cccccccCCCCcceeEEEEcc
Q 040274 183 SRYMGNSMVKGYQIGKVSFRP 203 (359)
Q Consensus 183 ~~~~~~~~~~~~~v~~~~~sp 203 (359)
...... ...|.++.|+|
T Consensus 99 ~~~~s~----e~~is~~~w~~ 115 (665)
T KOG4640|consen 99 SFLFSV----ETDISKGIWDR 115 (665)
T ss_pred cccccc----ccchheeeccc
Confidence 322222 22677888864
No 367
>PF15390 DUF4613: Domain of unknown function (DUF4613)
Probab=96.55 E-value=0.086 Score=50.43 Aligned_cols=141 Identities=12% Similarity=0.072 Sum_probs=81.3
Q ss_pred ceeEEEEcCCCCEEEEEe--CCCeEEEEeCCCCcceEEeecCCCCeEEEEEecC----CCEEEEecCCCeEEEEEcCC--
Q 040274 69 RTDLMRVNPFNGVVSLGH--SGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPN----GHLMATTGKECKIKIWDLRK-- 140 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~--~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~----g~~l~s~~~d~~i~vwd~~~-- 140 (359)
+++.++|-...+.+.|.- .+|.+.+=|. .. .+.-..|.+++|.|- -.-|+..-....|.||.+..
T Consensus 21 PvhGlaWTDGkqVvLT~L~l~~gE~kfGds---~v----iGqFEhV~GlsW~P~~~~~~paLLAVQHkkhVtVWqL~~s~ 93 (671)
T PF15390_consen 21 PVHGLAWTDGKQVVLTDLQLHNGEPKFGDS---KV----IGQFEHVHGLSWAPPCTADTPALLAVQHKKHVTVWQLCPST 93 (671)
T ss_pred cccceEecCCCEEEEEeeeeeCCccccCCc---cE----eeccceeeeeeecCcccCCCCceEEEeccceEEEEEeccCc
Confidence 677777764444444432 3344433321 12 244556899999983 32455556778899998852
Q ss_pred ---CeeeEee----cC--C--ceeEEEcCCC-cEEEEcCCcEE-EEcCCCCCccccccccccCCCCcceeEEEEccCCCE
Q 040274 141 ---YEVLQTL----TG--H--AKTLDFSQKG-LLAVGTGSFAQ-ILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDV 207 (359)
Q Consensus 141 ---~~~~~~~----~~--~--v~~~~~s~~g-l~~~~~d~~i~-v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~ 207 (359)
++.+.+. .. + ...+.|+|.. ++++-....+. ++++......+..-... .+.|.|.+|.+||..
T Consensus 94 ~e~~K~l~sQtcEi~e~~pvLpQGCVWHPk~~iL~VLT~~dvSV~~sV~~d~srVkaDi~~----~G~IhCACWT~DG~R 169 (671)
T PF15390_consen 94 TERNKLLMSQTCEIREPFPVLPQGCVWHPKKAILTVLTARDVSVLPSVHCDSSRVKADIKT----SGLIHCACWTKDGQR 169 (671)
T ss_pred cccccceeeeeeeccCCcccCCCcccccCCCceEEEEecCceeEeeeeeeCCceEEEeccC----CceEEEEEecCcCCE
Confidence 2222222 11 2 3678999998 66655544443 44544333333222222 237999999999999
Q ss_pred EEEEeCCCeE-EEE
Q 040274 208 LGIGHSMGWS-GIL 220 (359)
Q Consensus 208 l~~g~~dg~~-~i~ 220 (359)
|+++-..... .||
T Consensus 170 LVVAvGSsLHSyiW 183 (671)
T PF15390_consen 170 LVVAVGSSLHSYIW 183 (671)
T ss_pred EEEEeCCeEEEEEe
Confidence 8887766543 344
No 368
>PF14870 PSII_BNR: Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=96.54 E-value=0.55 Score=42.16 Aligned_cols=113 Identities=19% Similarity=0.389 Sum_probs=62.6
Q ss_pred CCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC--CeeeEee-cCCceeEEEcCCC-cEEEEcCCcEEEEcCCCCCcccc
Q 040274 108 HQGPVSALAFHPNGHLMATTGKECKIKIWDLRK--YEVLQTL-TGHAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYS 183 (359)
Q Consensus 108 h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~--~~~~~~~-~~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~ 183 (359)
-.+.+..+..+++|.++++++.-..+.-||.-. ..+.... ...+.++.|+|++ +...+.++.|++=+.........
T Consensus 143 ~~gs~~~~~r~~dG~~vavs~~G~~~~s~~~G~~~w~~~~r~~~~riq~~gf~~~~~lw~~~~Gg~~~~s~~~~~~~~w~ 222 (302)
T PF14870_consen 143 TSGSINDITRSSDGRYVAVSSRGNFYSSWDPGQTTWQPHNRNSSRRIQSMGFSPDGNLWMLARGGQIQFSDDPDDGETWS 222 (302)
T ss_dssp ----EEEEEE-TTS-EEEEETTSSEEEEE-TT-SS-EEEE--SSS-EEEEEE-TTS-EEEEETTTEEEEEE-TTEEEEE-
T ss_pred CcceeEeEEECCCCcEEEEECcccEEEEecCCCccceEEccCccceehhceecCCCCEEEEeCCcEEEEccCCCCccccc
Confidence 346688888899999998887766667887642 3333333 4568999999999 77777888888776222111111
Q ss_pred c-cccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCC
Q 040274 184 R-YMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRS 224 (359)
Q Consensus 184 ~-~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs 224 (359)
. ..... ..+..+..++|.+++...++|+... ++++-.
T Consensus 223 ~~~~~~~-~~~~~~ld~a~~~~~~~wa~gg~G~---l~~S~D 260 (302)
T PF14870_consen 223 EPIIPIK-TNGYGILDLAYRPPNEIWAVGGSGT---LLVSTD 260 (302)
T ss_dssp --B-TTS-S--S-EEEEEESSSS-EEEEESTT----EEEESS
T ss_pred cccCCcc-cCceeeEEEEecCCCCEEEEeCCcc---EEEeCC
Confidence 1 11110 0233589999999988888777664 555443
No 369
>PF02897 Peptidase_S9_N: Prolyl oligopeptidase, N-terminal beta-propeller domain; InterPro: IPR004106 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This entry represents the beta-propeller domain found at the N-terminal of prolyl oligopeptidase, including acylamino-acid-releasing enzyme (also known as acylaminoacyl peptidase), which belong to the MEROPS peptidase family S9 (clan SC), subfamily S9A. The prolyl oligopeptidase family consist of a number of evolutionary related peptidases whose catalytic activity seems to be provided by a charge relay system similar to that of the trypsin family of serine proteases, but which evolved by independent convergent evolution. The N-terminal domain of prolyl oligopeptidases form an unusual 7-bladed beta-propeller consisting of seven 4-stranded beta-sheet motifs. Prolyl oligopeptidase is a large cytosolic enzyme involved in the maturation and degradation of peptide hormones and neuropeptides, which relate to the induction of amnesia. The enzyme contains a peptidase domain, where its catalytic triad (Ser554, His680, Asp641) is covered by the central tunnel of the N-terminal beta-propeller domain. In this way, large structured peptides are excluded from the active site, thereby protecting larger peptides and proteins from proteolysis in the cytosol []. The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. Mammalian acylaminoacyl peptidase is an exopeptidase that is a member of the same prolyl oligopeptidase family of serine peptidases. This enzyme removes acylated amino acid residues from the N terminus of oligopeptides [].; GO: 0004252 serine-type endopeptidase activity, 0006508 proteolysis; PDB: 2BKL_B 3DDU_A 1YR2_A 2XE4_A 1VZ3_A 3EQ9_A 1O6F_A 3EQ7_A 4AN0_A 1UOP_A ....
Probab=96.53 E-value=0.16 Score=47.98 Aligned_cols=106 Identities=15% Similarity=0.175 Sum_probs=64.8
Q ss_pred eEEEEcCCCCEEEEE-eCCC----eEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCC-----------CeEE
Q 040274 71 DLMRVNPFNGVVSLG-HSGG----TVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKE-----------CKIK 134 (359)
Q Consensus 71 ~~l~~sp~~~~l~tg-~~dg----~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d-----------~~i~ 134 (359)
..+.+||+|++++.+ +..| .|+++|+.+++.+........ ..++.|.+++..|+....+ ..|+
T Consensus 127 ~~~~~Spdg~~la~~~s~~G~e~~~l~v~Dl~tg~~l~d~i~~~~-~~~~~W~~d~~~~~y~~~~~~~~~~~~~~~~~v~ 205 (414)
T PF02897_consen 127 GGFSVSPDGKRLAYSLSDGGSEWYTLRVFDLETGKFLPDGIENPK-FSSVSWSDDGKGFFYTRFDEDQRTSDSGYPRQVY 205 (414)
T ss_dssp EEEEETTTSSEEEEEEEETTSSEEEEEEEETTTTEEEEEEEEEEE-SEEEEECTTSSEEEEEECSTTTSS-CCGCCEEEE
T ss_pred eeeeECCCCCEEEEEecCCCCceEEEEEEECCCCcCcCCcccccc-cceEEEeCCCCEEEEEEeCcccccccCCCCcEEE
Confidence 357889999988766 3444 599999999976654322111 2339999998887665432 2478
Q ss_pred EEEcCCCe----eeEeecC--C-ceeEEEcCCC---cEEEEcC---CcEEEEcCCC
Q 040274 135 IWDLRKYE----VLQTLTG--H-AKTLDFSQKG---LLAVGTG---SFAQILGDFS 177 (359)
Q Consensus 135 vwd~~~~~----~~~~~~~--~-v~~~~~s~~g---l~~~~~d---~~i~v~d~~~ 177 (359)
.|.+.+.. ++..-.. . ...+..++++ ++..... ..+.+.|+..
T Consensus 206 ~~~~gt~~~~d~lvfe~~~~~~~~~~~~~s~d~~~l~i~~~~~~~~s~v~~~d~~~ 261 (414)
T PF02897_consen 206 RHKLGTPQSEDELVFEEPDEPFWFVSVSRSKDGRYLFISSSSGTSESEVYLLDLDD 261 (414)
T ss_dssp EEETTS-GGG-EEEEC-TTCTTSEEEEEE-TTSSEEEEEEESSSSEEEEEEEECCC
T ss_pred EEECCCChHhCeeEEeecCCCcEEEEEEecCcccEEEEEEEccccCCeEEEEeccc
Confidence 88887653 2322222 2 4578889999 3333332 3577777544
No 370
>PF12894 Apc4_WD40: Anaphase-promoting complex subunit 4 WD40 domain
Probab=96.51 E-value=0.0082 Score=37.45 Aligned_cols=35 Identities=17% Similarity=0.424 Sum_probs=30.0
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeee
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVL 144 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~ 144 (359)
...|.+++|+|...++|.++.||.|.+|.+ +++.+
T Consensus 11 ~~~v~~~~w~P~mdLiA~~t~~g~v~v~Rl-~~qri 45 (47)
T PF12894_consen 11 PSRVSCMSWCPTMDLIALGTEDGEVLVYRL-NWQRI 45 (47)
T ss_pred CCcEEEEEECCCCCEEEEEECCCeEEEEEC-CCcCc
Confidence 456899999999999999999999999998 45443
No 371
>PF03178 CPSF_A: CPSF A subunit region; InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=96.51 E-value=0.13 Score=46.76 Aligned_cols=146 Identities=14% Similarity=0.146 Sum_probs=81.1
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCc-ceEEee-cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC-CeeeE
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSA-LLIKML-YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRK-YEVLQ 145 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~-~~~~~~-~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~-~~~~~ 145 (359)
+|++|+-- +..|+++. ++.|.+|++.... ....-. .....++++... +++++.|+....+.++..+. +..+.
T Consensus 90 ~V~ai~~~--~~~lv~~~-g~~l~v~~l~~~~~l~~~~~~~~~~~i~sl~~~--~~~I~vgD~~~sv~~~~~~~~~~~l~ 164 (321)
T PF03178_consen 90 PVTAICSF--NGRLVVAV-GNKLYVYDLDNSKTLLKKAFYDSPFYITSLSVF--KNYILVGDAMKSVSLLRYDEENNKLI 164 (321)
T ss_dssp -EEEEEEE--TTEEEEEE-TTEEEEEEEETTSSEEEEEEE-BSSSEEEEEEE--TTEEEEEESSSSEEEEEEETTTE-EE
T ss_pred cceEhhhh--CCEEEEee-cCEEEEEEccCcccchhhheecceEEEEEEecc--ccEEEEEEcccCEEEEEEEccCCEEE
Confidence 67777655 33444443 4789999998776 333222 223355555554 56999998888888775443 33233
Q ss_pred ee-----cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCC------Cc-cccc-cccccCCCCcceeEE---EEccC--C
Q 040274 146 TL-----TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSG------SH-NYSR-YMGNSMVKGYQIGKV---SFRPY--E 205 (359)
Q Consensus 146 ~~-----~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~------~~-~~~~-~~~~~~~~~~~v~~~---~~sp~--~ 205 (359)
.+ +..++++.|-+++ ++++..+|.+.++..... +. .... ..-| .+..|+++ ++.|. +
T Consensus 165 ~va~d~~~~~v~~~~~l~d~~~~i~~D~~gnl~~l~~~~~~~~~~~~~~~L~~~~~f~---lg~~v~~~~~~~l~~~~~~ 241 (321)
T PF03178_consen 165 LVARDYQPRWVTAAEFLVDEDTIIVGDKDGNLFVLRYNPEIPNSRDGDPKLERISSFH---LGDIVNSFRRGSLIPRSGS 241 (321)
T ss_dssp EEEEESS-BEEEEEEEE-SSSEEEEEETTSEEEEEEE-SS-SSTTTTTTBEEEEEEEE----SS-EEEEEE--SS--SSS
T ss_pred EEEecCCCccEEEEEEecCCcEEEEEcCCCeEEEEEECCCCcccccccccceeEEEEE---CCCccceEEEEEeeecCCC
Confidence 33 2346888887555 778888999998875321 11 1111 1112 34467777 55552 2
Q ss_pred C------EEEEEeCCCeEEEEEc
Q 040274 206 D------VLGIGHSMGWSGILVP 222 (359)
Q Consensus 206 ~------~l~~g~~dg~~~i~~~ 222 (359)
. .++.++.+|.+.++.+
T Consensus 242 ~~~~~~~~i~~~T~~G~Ig~l~p 264 (321)
T PF03178_consen 242 SESPNRPQILYGTVDGSIGVLIP 264 (321)
T ss_dssp S-TTEEEEEEEEETTS-EEEEEE
T ss_pred CcccccceEEEEecCCEEEEEEe
Confidence 2 4777888887776665
No 372
>PF00930 DPPIV_N: Dipeptidyl peptidase IV (DPP IV) N-terminal region; InterPro: IPR002469 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This domain defines serine peptidases belonging to MEROPS peptidase family S9 (clan SC), subfamily S9B (dipeptidyl-peptidase IV). The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. This domain is an alignment of the region to the N-terminal side of the active site, which is found in IPR001375 from INTERPRO. CD26 (3.4.14.5 from EC) is also called adenosine deaminase-binding protein (ADA-binding protein) or dipeptidylpeptidase IV (DPP IV ectoenzyme). The exopeptidase cleaves off N-terminal X-Pro or X-Ala dipeptides from polypeptides (dipeptidyl peptidase IV activity). CD26 serves as the costimulatory molecule in T cell activation and is an associated marker of autoimmune diseases, adenosine deaminase-deficiency and HIV pathogenesis. Dipeptidyl peptidase IV (DPP IV) is responsible for the removal of N-terminal dipeptides sequentially from polypeptides having unsubstituted N termini, provided that the penultimate residue is proline. The enzyme catalyses the reaction: Dipeptidyl-Polypeptide + H(2)O = Dipeptide + Polypeptide It is a type II membrane protein that forms a homodimer. CD molecules are leucocyte antigens on cell surfaces. CD antigens nomenclature is updated at Protein Reviews On The Web (http://prow.nci.nih.gov/). ; GO: 0006508 proteolysis, 0016020 membrane; PDB: 2RIP_A 3Q8W_B 2AJL_I 1TKR_B 1TK3_B 3C45_A 2G5P_A 3G0C_D 1R9M_C 1RWQ_A ....
Probab=96.49 E-value=0.013 Score=54.31 Aligned_cols=97 Identities=14% Similarity=0.105 Sum_probs=60.4
Q ss_pred ecCCCEEEEec---------CCCeEEEEEcCCCeeeEee--cCCceeEEEcCCC-cEEEEcCCcEEEEcCCCCCcccccc
Q 040274 118 HPNGHLMATTG---------KECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRY 185 (359)
Q Consensus 118 ~p~g~~l~s~~---------~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~ 185 (359)
|||+++++... ..+.+.+||+.+++..... ...+....|||+| .++...++.|.++++..+.....+.
T Consensus 1 S~d~~~~l~~~~~~~~~r~s~~~~y~i~d~~~~~~~~l~~~~~~~~~~~~sP~g~~~~~v~~~nly~~~~~~~~~~~lT~ 80 (353)
T PF00930_consen 1 SPDGKFVLFATNYTKQWRHSFKGDYYIYDIETGEITPLTPPPPKLQDAKWSPDGKYIAFVRDNNLYLRDLATGQETQLTT 80 (353)
T ss_dssp -TTSSEEEEEEEEEEESSSEEEEEEEEEETTTTEEEESS-EETTBSEEEE-SSSTEEEEEETTEEEEESSTTSEEEESES
T ss_pred CCCCCeEEEEECcEEeeeeccceeEEEEecCCCceEECcCCccccccceeecCCCeeEEEecCceEEEECCCCCeEEecc
Confidence 57777766632 2367999999997654433 4578999999999 7888888999999865542211111
Q ss_pred cccc----CCC--------CcceeEEEEccCCCEEEEEeCC
Q 040274 186 MGNS----MVK--------GYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 186 ~~~~----~~~--------~~~v~~~~~sp~~~~l~~g~~d 214 (359)
.+.. +.+ -..-..+-|||||++|+....|
T Consensus 81 dg~~~i~nG~~dwvyeEEv~~~~~~~~WSpd~~~la~~~~d 121 (353)
T PF00930_consen 81 DGEPGIYNGVPDWVYEEEVFDRRSAVWWSPDSKYLAFLRFD 121 (353)
T ss_dssp --TTTEEESB--HHHHHHTSSSSBSEEE-TTSSEEEEEEEE
T ss_pred ccceeEEcCccceeccccccccccceEECCCCCEEEEEEEC
Confidence 1100 000 1123568899999999876544
No 373
>KOG2079 consensus Vacuolar assembly/sorting protein VPS8 [Intracellular trafficking, secretion, and vesicular transport]
Probab=96.42 E-value=0.099 Score=53.24 Aligned_cols=68 Identities=21% Similarity=0.391 Sum_probs=55.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEE---ecCCCEEEEecCCCeEEEEEc
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAF---HPNGHLMATTGKECKIKIWDL 138 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~---~p~g~~l~s~~~d~~i~vwd~ 138 (359)
+|++++|+.+|..++.|..+|.|.+||+.++.++..+..|..+++++-+ ..++..++++..-|. +|.+
T Consensus 132 ~Vtsvafn~dg~~l~~G~~~G~V~v~D~~~~k~l~~i~e~~ap~t~vi~v~~t~~nS~llt~D~~Gs--f~~l 202 (1206)
T KOG2079|consen 132 PVTSVAFNQDGSLLLAGLGDGHVTVWDMHRAKILKVITEHGAPVTGVIFVGRTSQNSKLLTSDTGGS--FWKL 202 (1206)
T ss_pred cceeeEecCCCceeccccCCCcEEEEEccCCcceeeeeecCCccceEEEEEEeCCCcEEEEccCCCc--eEEE
Confidence 8999999999999999999999999999999988888877666555443 445667888877776 5543
No 374
>PF15390 DUF4613: Domain of unknown function (DUF4613)
Probab=96.37 E-value=0.18 Score=48.28 Aligned_cols=107 Identities=15% Similarity=0.208 Sum_probs=68.8
Q ss_pred ceeEEEEcCCC----CEEEEEeCCCeEEEEeCC-----CCcceEEeecCCC---C--eEEEEEecCCCEEEEecCCCeEE
Q 040274 69 RTDLMRVNPFN----GVVSLGHSGGTVTMWKPT-----TSALLIKMLYHQG---P--VSALAFHPNGHLMATTGKECKIK 134 (359)
Q Consensus 69 ~v~~l~~sp~~----~~l~tg~~dg~v~lwd~~-----~~~~~~~~~~h~~---~--v~~l~~~p~g~~l~s~~~d~~i~ 134 (359)
.|..+.|.|-+ ..+.+.-....|.||.+. +++.+..-.++-+ + -.++.|+|....|+.-.....-.
T Consensus 58 hV~GlsW~P~~~~~~paLLAVQHkkhVtVWqL~~s~~e~~K~l~sQtcEi~e~~pvLpQGCVWHPk~~iL~VLT~~dvSV 137 (671)
T PF15390_consen 58 HVHGLSWAPPCTADTPALLAVQHKKHVTVWQLCPSTTERNKLLMSQTCEIREPFPVLPQGCVWHPKKAILTVLTARDVSV 137 (671)
T ss_pred eeeeeeecCcccCCCCceEEEeccceEEEEEeccCccccccceeeeeeeccCCcccCCCcccccCCCceEEEEecCceeE
Confidence 89999999953 234445556789999875 2333333323221 1 24678999888877766655545
Q ss_pred EEEcCCC--eeeEee--cCCceeEEEcCCC---cEEEEcCCcEEEEcC
Q 040274 135 IWDLRKY--EVLQTL--TGHAKTLDFSQKG---LLAVGTGSFAQILGD 175 (359)
Q Consensus 135 vwd~~~~--~~~~~~--~~~v~~~~~s~~g---l~~~~~d~~i~v~d~ 175 (359)
+++++.. .....+ .|.|.|.+|.+|| +++.+..=.-+|||.
T Consensus 138 ~~sV~~d~srVkaDi~~~G~IhCACWT~DG~RLVVAvGSsLHSyiWd~ 185 (671)
T PF15390_consen 138 LPSVHCDSSRVKADIKTSGLIHCACWTKDGQRLVVAVGSSLHSYIWDS 185 (671)
T ss_pred eeeeeeCCceEEEeccCCceEEEEEecCcCCEEEEEeCCeEEEEEecC
Confidence 5666543 223333 6789999999999 455555556789984
No 375
>PF02897 Peptidase_S9_N: Prolyl oligopeptidase, N-terminal beta-propeller domain; InterPro: IPR004106 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This entry represents the beta-propeller domain found at the N-terminal of prolyl oligopeptidase, including acylamino-acid-releasing enzyme (also known as acylaminoacyl peptidase), which belong to the MEROPS peptidase family S9 (clan SC), subfamily S9A. The prolyl oligopeptidase family consist of a number of evolutionary related peptidases whose catalytic activity seems to be provided by a charge relay system similar to that of the trypsin family of serine proteases, but which evolved by independent convergent evolution. The N-terminal domain of prolyl oligopeptidases form an unusual 7-bladed beta-propeller consisting of seven 4-stranded beta-sheet motifs. Prolyl oligopeptidase is a large cytosolic enzyme involved in the maturation and degradation of peptide hormones and neuropeptides, which relate to the induction of amnesia. The enzyme contains a peptidase domain, where its catalytic triad (Ser554, His680, Asp641) is covered by the central tunnel of the N-terminal beta-propeller domain. In this way, large structured peptides are excluded from the active site, thereby protecting larger peptides and proteins from proteolysis in the cytosol []. The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. Mammalian acylaminoacyl peptidase is an exopeptidase that is a member of the same prolyl oligopeptidase family of serine peptidases. This enzyme removes acylated amino acid residues from the N terminus of oligopeptides [].; GO: 0004252 serine-type endopeptidase activity, 0006508 proteolysis; PDB: 2BKL_B 3DDU_A 1YR2_A 2XE4_A 1VZ3_A 3EQ9_A 1O6F_A 3EQ7_A 4AN0_A 1UOP_A ....
Probab=96.37 E-value=0.89 Score=42.96 Aligned_cols=89 Identities=10% Similarity=0.046 Sum_probs=58.1
Q ss_pred EEEECCCCCEEEEecc---------------------------ceeEEEEcCCCCEEEEEeCCC-----------eEEEE
Q 040274 53 LWILPSSGRYMAVAGR---------------------------RTDLMRVNPFNGVVSLGHSGG-----------TVTMW 94 (359)
Q Consensus 53 ~l~~spdg~~l~~~~~---------------------------~v~~l~~sp~~~~l~tg~~dg-----------~v~lw 94 (359)
.+.+||||++||.+-. ....+.|.+++..|+....+. .|++|
T Consensus 128 ~~~~Spdg~~la~~~s~~G~e~~~l~v~Dl~tg~~l~d~i~~~~~~~~~W~~d~~~~~y~~~~~~~~~~~~~~~~~v~~~ 207 (414)
T PF02897_consen 128 GFSVSPDGKRLAYSLSDGGSEWYTLRVFDLETGKFLPDGIENPKFSSVSWSDDGKGFFYTRFDEDQRTSDSGYPRQVYRH 207 (414)
T ss_dssp EEEETTTSSEEEEEEEETTSSEEEEEEEETTTTEEEEEEEEEEESEEEEECTTSSEEEEEECSTTTSS-CCGCCEEEEEE
T ss_pred eeeECCCCCEEEEEecCCCCceEEEEEEECCCCcCcCCcccccccceEEEeCCCCEEEEEEeCcccccccCCCCcEEEEE
Confidence 5678999999997643 223499999988776665332 37888
Q ss_pred eCCCCcce--EEeecCCCC--eEEEEEecCCCEEEEecC---C-CeEEEEEcCCC
Q 040274 95 KPTTSALL--IKMLYHQGP--VSALAFHPNGHLMATTGK---E-CKIKIWDLRKY 141 (359)
Q Consensus 95 d~~~~~~~--~~~~~h~~~--v~~l~~~p~g~~l~s~~~---d-~~i~vwd~~~~ 141 (359)
.+.+.... ..+...... ...+..++|+++|+..+. + ..+++.|+..+
T Consensus 208 ~~gt~~~~d~lvfe~~~~~~~~~~~~~s~d~~~l~i~~~~~~~~s~v~~~d~~~~ 262 (414)
T PF02897_consen 208 KLGTPQSEDELVFEEPDEPFWFVSVSRSKDGRYLFISSSSGTSESEVYLLDLDDG 262 (414)
T ss_dssp ETTS-GGG-EEEEC-TTCTTSEEEEEE-TTSSEEEEEEESSSSEEEEEEEECCCT
T ss_pred ECCCChHhCeeEEeecCCCcEEEEEEecCcccEEEEEEEccccCCeEEEEecccc
Confidence 88776433 444443333 567888999998764332 3 45788888764
No 376
>KOG2079 consensus Vacuolar assembly/sorting protein VPS8 [Intracellular trafficking, secretion, and vesicular transport]
Probab=96.36 E-value=0.012 Score=59.56 Aligned_cols=70 Identities=24% Similarity=0.440 Sum_probs=55.1
Q ss_pred CCCEEEEEeCCCeEEEEeCCCC-cceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee
Q 040274 78 FNGVVSLGHSGGTVTMWKPTTS-ALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL 147 (359)
Q Consensus 78 ~~~~l~tg~~dg~v~lwd~~~~-~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~ 147 (359)
.+..++.|+..|.|-..|.... .+...=..-.++|++++|+.+|..++.|-.+|.|.+||+..+..++.+
T Consensus 98 ~~~~ivi~Ts~ghvl~~d~~~nL~~~~~ne~v~~~Vtsvafn~dg~~l~~G~~~G~V~v~D~~~~k~l~~i 168 (1206)
T KOG2079|consen 98 VVVPIVIGTSHGHVLLSDMTGNLGPLHQNERVQGPVTSVAFNQDGSLLLAGLGDGHVTVWDMHRAKILKVI 168 (1206)
T ss_pred eeeeEEEEcCchhhhhhhhhcccchhhcCCccCCcceeeEecCCCceeccccCCCcEEEEEccCCcceeee
Confidence 4667888998899988887653 111111123679999999999999999999999999999998887777
No 377
>PF08553 VID27: VID27 cytoplasmic protein; InterPro: IPR013863 This entry represents fungal and plant proteins and contains many hypothetical proteins. Vid27p is a cytoplasmic protein of unknown function, possibly regulates import of fructose-1,6-bisphosphatase into Vacuolar Import and Degradation (Vid) vesicles and is not essential for proteasome-dependent degradation of fructose-1,6-bisphosphatase (FBPase) [, ].
Probab=96.33 E-value=0.028 Score=56.51 Aligned_cols=94 Identities=17% Similarity=0.245 Sum_probs=67.8
Q ss_pred EEEEEeCCCeEEEEeCCCCc-ceEEee----cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCee---eEeecCCce
Q 040274 81 VVSLGHSGGTVTMWKPTTSA-LLIKML----YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEV---LQTLTGHAK 152 (359)
Q Consensus 81 ~l~tg~~dg~v~lwd~~~~~-~~~~~~----~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~---~~~~~~~v~ 152 (359)
..++|-.+..+..||++-.. .+..-. ......+|++-+.+| +||.|+.+|.|++||-..... +..+..+|.
T Consensus 544 ~tflGls~n~lfriDpR~~~~k~v~~~~k~Y~~~~~Fs~~aTt~~G-~iavgs~~G~IRLyd~~g~~AKT~lp~lG~pI~ 622 (794)
T PF08553_consen 544 QTFLGLSDNSLFRIDPRLSGNKLVDSQSKQYSSKNNFSCFATTEDG-YIAVGSNKGDIRLYDRLGKRAKTALPGLGDPII 622 (794)
T ss_pred ceEEEECCCceEEeccCCCCCceeeccccccccCCCceEEEecCCc-eEEEEeCCCcEEeecccchhhhhcCCCCCCCee
Confidence 45678888999999998542 222111 234456777766666 799999999999999432222 223356899
Q ss_pred eEEEcCCC-cEEEEcCCcEEEEcC
Q 040274 153 TLDFSQKG-LLAVGTGSFAQILGD 175 (359)
Q Consensus 153 ~~~~s~~g-l~~~~~d~~i~v~d~ 175 (359)
.|+.+.|| ++.+..+..|.++++
T Consensus 623 ~iDvt~DGkwilaTc~tyLlLi~t 646 (794)
T PF08553_consen 623 GIDVTADGKWILATCKTYLLLIDT 646 (794)
T ss_pred EEEecCCCcEEEEeecceEEEEEE
Confidence 99999999 777788888888885
No 378
>KOG3630 consensus Nuclear pore complex, Nup214/CAN component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=96.21 E-value=0.036 Score=56.54 Aligned_cols=141 Identities=10% Similarity=0.015 Sum_probs=86.0
Q ss_pred ceeEEEEcCCCCEEEEEe--CCCeEEEEeCCCCc--------ceE---EeecCCCCeEEEEEecCCC-EEEEecCCCeEE
Q 040274 69 RTDLMRVNPFNGVVSLGH--SGGTVTMWKPTTSA--------LLI---KMLYHQGPVSALAFHPNGH-LMATTGKECKIK 134 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~--~dg~v~lwd~~~~~--------~~~---~~~~h~~~v~~l~~~p~g~-~l~s~~~d~~i~ 134 (359)
.+..+..++|+...++.+ .+-.|..||+.+-. ++. +.........++.|+|.-. ..+.+..|+.|.
T Consensus 102 pi~~~v~~~D~t~s~v~~tsng~~v~~fD~~~fs~s~~~~~~pl~~s~ts~ek~vf~~~~~wnP~vp~n~av~l~dlsl~ 181 (1405)
T KOG3630|consen 102 PIVIFVCFHDATDSVVVSTSNGEAVYSFDLEEFSESRYETTVPLKNSATSFEKPVFQLKNVWNPLVPLNSAVDLSDLSLR 181 (1405)
T ss_pred cceEEEeccCCceEEEEEecCCceEEEEehHhhhhhhhhhccccccccchhccccccccccccCCccchhhhhccccchh
Confidence 566777777766544433 44478999986431 111 1112234567788998543 356677889888
Q ss_pred EEEcCCCe-eeEee--cCCceeEEEcCCC--cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEE
Q 040274 135 IWDLRKYE-VLQTL--TGHAKTLDFSQKG--LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLG 209 (359)
Q Consensus 135 vwd~~~~~-~~~~~--~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~ 209 (359)
+.-+.... .+.++ ....++++|+|.| ++.+-..|++.-|.. .. .....+........+.|.||+|.....||+
T Consensus 182 V~~~~~~~~~v~s~p~t~~~Tav~WSprGKQl~iG~nnGt~vQy~P-~l-eik~~ip~Pp~~e~yrvl~v~Wl~t~eflv 259 (1405)
T KOG3630|consen 182 VKSTKQLAQNVTSFPVTNSQTAVLWSPRGKQLFIGRNNGTEVQYEP-SL-EIKSEIPEPPVEENYRVLSVTWLSTQEFLV 259 (1405)
T ss_pred hhhhhhhhhhhcccCcccceeeEEeccccceeeEecCCCeEEEeec-cc-ceeecccCCCcCCCcceeEEEEecceeEEE
Confidence 88765332 23333 3346999999999 666667788888863 22 222222222211234799999998888776
Q ss_pred EE
Q 040274 210 IG 211 (359)
Q Consensus 210 ~g 211 (359)
+-
T Consensus 260 vy 261 (1405)
T KOG3630|consen 260 VY 261 (1405)
T ss_pred Ee
Confidence 53
No 379
>PRK13684 Ycf48-like protein; Provisional
Probab=96.21 E-value=0.97 Score=41.45 Aligned_cols=143 Identities=17% Similarity=0.207 Sum_probs=78.7
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEE-EeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTM-WKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~l-wd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~ 147 (359)
.+.++.+.|++.++++|. .|.+.. ++-...........-...++++.+.+++..++++ ..|.+.+=..+.+..-...
T Consensus 174 ~~~~i~~~~~g~~v~~g~-~G~i~~s~~~gg~tW~~~~~~~~~~l~~i~~~~~g~~~~vg-~~G~~~~~s~d~G~sW~~~ 251 (334)
T PRK13684 174 VVRNLRRSPDGKYVAVSS-RGNFYSTWEPGQTAWTPHQRNSSRRLQSMGFQPDGNLWMLA-RGGQIRFNDPDDLESWSKP 251 (334)
T ss_pred eEEEEEECCCCeEEEEeC-CceEEEEcCCCCCeEEEeeCCCcccceeeeEcCCCCEEEEe-cCCEEEEccCCCCCccccc
Confidence 578889999886665554 455432 2211111111122334678999999998876654 5576643223333322211
Q ss_pred --c-----CCceeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeE
Q 040274 148 --T-----GHAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWS 217 (359)
Q Consensus 148 --~-----~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~ 217 (359)
+ ..+.++.+.|++ +++++.+|.+..- ...+........... .....+.+.|..++..+++| ..|.+
T Consensus 252 ~~~~~~~~~~l~~v~~~~~~~~~~~G~~G~v~~S--~d~G~tW~~~~~~~~-~~~~~~~~~~~~~~~~~~~G-~~G~i 325 (334)
T PRK13684 252 IIPEITNGYGYLDLAYRTPGEIWAGGGNGTLLVS--KDGGKTWEKDPVGEE-VPSNFYKIVFLDPEKGFVLG-QRGVL 325 (334)
T ss_pred cCCccccccceeeEEEcCCCCEEEEcCCCeEEEe--CCCCCCCeECCcCCC-CCcceEEEEEeCCCceEEEC-CCceE
Confidence 1 236788899888 7788888866543 233333333222111 11257788888777665544 44543
No 380
>cd00216 PQQ_DH Dehydrogenases with pyrrolo-quinoline quinone (PQQ) as cofactor, like ethanol, methanol, and membrane bound glucose dehydrogenases. The alignment model contains an 8-bladed beta-propeller.
Probab=96.21 E-value=0.24 Score=48.06 Aligned_cols=153 Identities=10% Similarity=0.087 Sum_probs=84.1
Q ss_pred EEcCCCCEEEEEeCCC------------------eEEEEeCCCCcceEEeecCCCCe------EEEEEe----cCCC---
Q 040274 74 RVNPFNGVVSLGHSGG------------------TVTMWKPTTSALLIKMLYHQGPV------SALAFH----PNGH--- 122 (359)
Q Consensus 74 ~~sp~~~~l~tg~~dg------------------~v~lwd~~~~~~~~~~~~h~~~v------~~l~~~----p~g~--- 122 (359)
++++.+..++.++.|+ .|.-+|+.+|+.+..+..-.... ....+. -+|.
T Consensus 223 a~d~~~g~V~vg~~~g~~~~~~~~~~~~~~~~~~~l~Ald~~tG~~~W~~~~~~~~~~~~~~~s~p~~~~~~~~~g~~~~ 302 (488)
T cd00216 223 TYDPKTNLVYVGTGNGSPWNWGGRRTPGDNLYTDSIVALDADTGKVKWFYQTTPHDLWDYDGPNQPSLADIKPKDGKPVP 302 (488)
T ss_pred eEeCCCCEEEEECCCCCCCccCCccCCCCCCceeeEEEEcCCCCCEEEEeeCCCCCCcccccCCCCeEEeccccCCCeeE
Confidence 3444456777777665 79999999999888765211111 111111 1333
Q ss_pred EEEEecCCCeEEEEEcCCCeeeEeecCCceeEEEcCCCcEEE------------------EcCCcEEEEcCCCCCccccc
Q 040274 123 LMATTGKECKIKIWDLRKYEVLQTLTGHAKTLDFSQKGLLAV------------------GTGSFAQILGDFSGSHNYSR 184 (359)
Q Consensus 123 ~l~s~~~d~~i~vwd~~~~~~~~~~~~~v~~~~~s~~gl~~~------------------~~d~~i~v~d~~~~~~~~~~ 184 (359)
.++.++.+|.+...|..+|+.+.........+..+|+-++.. ..+|.|.-+|+.++......
T Consensus 303 ~V~~g~~~G~l~ald~~tG~~~W~~~~~~~~~~~~~~~vyv~~~~~~~~~~~~~~~~~~~~~~G~l~AlD~~tG~~~W~~ 382 (488)
T cd00216 303 AIVHAPKNGFFYVLDRTTGKLISARPEVEQPMAYDPGLVYLGAFHIPLGLPPQKKKRCKKPGKGGLAALDPKTGKVVWEK 382 (488)
T ss_pred EEEEECCCceEEEEECCCCcEeeEeEeeccccccCCceEEEccccccccCcccccCCCCCCCceEEEEEeCCCCcEeeEe
Confidence 577888899999999999998877632222233444222221 12456777775554322221
Q ss_pred ccc-ccC--CCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCCC
Q 040274 185 YMG-NSM--VKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSSE 226 (359)
Q Consensus 185 ~~~-~~~--~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~~ 226 (359)
-.. +.. ..+.....-...-.+..|++|+.+|.+..+...+++
T Consensus 383 ~~~~~~~~~~~g~~~~~~~~~~~g~~v~~g~~dG~l~ald~~tG~ 427 (488)
T cd00216 383 REGTIRDSWNIGFPHWGGSLATAGNLVFAGAADGYFRAFDATTGK 427 (488)
T ss_pred eCCccccccccCCcccCcceEecCCeEEEECCCCeEEEEECCCCc
Confidence 111 000 000011111111256788888999988888776654
No 381
>PF05096 Glu_cyclase_2: Glutamine cyclotransferase; InterPro: IPR007788 This family of enzymes 2.3.2.5 from EC catalyse the cyclization of free L-glutamine and N-terminal glutaminyl residues in proteins to pyroglutamate (5-oxoproline) and pyroglutamyl residues respectively []. This family includes plant and bacterial enzymes and seems unrelated to the mammalian enzymes.; PDB: 3NOK_B 2FAW_A 2IWA_A 3NOM_A 3NOL_A 3MBR_X.
Probab=96.20 E-value=0.76 Score=40.13 Aligned_cols=154 Identities=11% Similarity=-0.004 Sum_probs=89.3
Q ss_pred eeEEEEcCCCCEEEEEeCCC--eEEEEeCCCCcceEEeecC-CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEe
Q 040274 70 TDLMRVNPFNGVVSLGHSGG--TVTMWKPTTSALLIKMLYH-QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQT 146 (359)
Q Consensus 70 v~~l~~sp~~~~l~tg~~dg--~v~lwd~~~~~~~~~~~~h-~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~ 146 (359)
...+.|..+|.++-+.+.-| .|+.+|+.+++.+....-. .-.--.++...| .+..-.=.++...+||..+.+.+.+
T Consensus 47 TQGL~~~~~g~LyESTG~yG~S~l~~~d~~tg~~~~~~~l~~~~FgEGit~~~d-~l~qLTWk~~~~f~yd~~tl~~~~~ 125 (264)
T PF05096_consen 47 TQGLEFLDDGTLYESTGLYGQSSLRKVDLETGKVLQSVPLPPRYFGEGITILGD-KLYQLTWKEGTGFVYDPNTLKKIGT 125 (264)
T ss_dssp EEEEEEEETTEEEEEECSTTEEEEEEEETTTSSEEEEEE-TTT--EEEEEEETT-EEEEEESSSSEEEEEETTTTEEEEE
T ss_pred CccEEecCCCEEEEeCCCCCcEEEEEEECCCCcEEEEEECCccccceeEEEECC-EEEEEEecCCeEEEEccccceEEEE
Confidence 34577766777777777666 7999999999876554422 222234444433 3344445689999999999998888
Q ss_pred e--cCCceeEEEcCCCcEEEEcCCcEEEEcCCCCCcccccccc-ccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 147 L--TGHAKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYMG-NSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 147 ~--~~~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~~-~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
+ ++.-+.++...+.++.+.....|+++|..+- .....+.- ..+.+-..++-+.|. +|.+.|-.-....|..+.|.
T Consensus 126 ~~y~~EGWGLt~dg~~Li~SDGS~~L~~~dP~~f-~~~~~i~V~~~g~pv~~LNELE~i-~G~IyANVW~td~I~~Idp~ 203 (264)
T PF05096_consen 126 FPYPGEGWGLTSDGKRLIMSDGSSRLYFLDPETF-KEVRTIQVTDNGRPVSNLNELEYI-NGKIYANVWQTDRIVRIDPE 203 (264)
T ss_dssp EE-SSS--EEEECSSCEEEE-SSSEEEEE-TTT--SEEEEEE-EETTEE---EEEEEEE-TTEEEEEETTSSEEEEEETT
T ss_pred EecCCcceEEEcCCCEEEEECCccceEEECCccc-ceEEEEEEEECCEECCCcEeEEEE-cCEEEEEeCCCCeEEEEeCC
Confidence 7 4555777743333666666789999995443 22222211 111022245667775 66666666666666677776
Q ss_pred CCC
Q 040274 224 SSE 226 (359)
Q Consensus 224 s~~ 226 (359)
+|.
T Consensus 204 tG~ 206 (264)
T PF05096_consen 204 TGK 206 (264)
T ss_dssp T-B
T ss_pred CCe
Confidence 654
No 382
>TIGR02604 Piru_Ver_Nterm putative membrane-bound dehydrogenase domain. All proteins that score above the trusted cutoff score of 45 to this model are large proteins of either Pirellula sp. 1 or Verrucomicrobium spinosum. These proteins all contain, in addition to this domain, several hundred residues of highly variable sequence, and then a well-conserved C-terminal domain (TIGR02603) that features a putative cytochrome c-type heme binding motif CXXCH. The membrane-bound L-sorbosone dehydrogenase from Acetobacter liquefaciens (Gluconacetobacter liquefaciens) is homologous to this domain but lacks additional sequence regions shared by members of this family and belongs to a different clade of the larger family of homologs. It and its closely related homologs are excluded from the this model by scoring between the trusted (45) and noise (18) cutoffs.
Probab=96.15 E-value=0.32 Score=45.29 Aligned_cols=139 Identities=13% Similarity=0.047 Sum_probs=71.4
Q ss_pred ceeEEEEcCCCCEEEEEe-----------CCC-eEEEEeCCC--Ccc--eEEeecCCCCeEEEEEecCCCEEEEecCCCe
Q 040274 69 RTDLMRVNPFNGVVSLGH-----------SGG-TVTMWKPTT--SAL--LIKMLYHQGPVSALAFHPNGHLMATTGKECK 132 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~-----------~dg-~v~lwd~~~--~~~--~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~ 132 (359)
....|+|.++|.++++-. ..+ .|.+++-.. +.. ...+.......+++++.++| ++++ +....
T Consensus 15 ~P~~ia~d~~G~l~V~e~~~y~~~~~~~~~~~~rI~~l~d~dgdG~~d~~~vfa~~l~~p~Gi~~~~~G-lyV~-~~~~i 92 (367)
T TIGR02604 15 NPIAVCFDERGRLWVAEGITYSRPAGRQGPLGDRILILEDADGDGKYDKSNVFAEELSMVTGLAVAVGG-VYVA-TPPDI 92 (367)
T ss_pred CCceeeECCCCCEEEEeCCcCCCCCCCCCCCCCEEEEEEcCCCCCCcceeEEeecCCCCccceeEecCC-EEEe-CCCeE
Confidence 456677777776655532 123 666665432 322 23333334456889999998 4444 44443
Q ss_pred EEEEEcCC-------Ceee-EeecC-----C--ceeEEEcCCC--cEEEEcC-------------------CcEEEEcCC
Q 040274 133 IKIWDLRK-------YEVL-QTLTG-----H--AKTLDFSQKG--LLAVGTG-------------------SFAQILGDF 176 (359)
Q Consensus 133 i~vwd~~~-------~~~~-~~~~~-----~--v~~~~~s~~g--l~~~~~d-------------------~~i~v~d~~ 176 (359)
+++.|... .+.+ ..+.. + +..+.|.||| +++.+.. +.|.-++..
T Consensus 93 ~~~~d~~gdg~ad~~~~~l~~~~~~~~~~~~~~~~~l~~gpDG~LYv~~G~~~~~~~~~~~~~~~~~~~~~g~i~r~~pd 172 (367)
T TIGR02604 93 LFLRDKDGDDKADGEREVLLSGFGGQINNHHHSLNSLAWGPDGWLYFNHGNTLASKVTRPGTSDESRQGLGGGLFRYNPD 172 (367)
T ss_pred EEEeCCCCCCCCCCccEEEEEccCCCCCcccccccCceECCCCCEEEecccCCCceeccCCCccCcccccCceEEEEecC
Confidence 33445432 1122 22311 1 5689999999 3433321 234444422
Q ss_pred CCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 177 SGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
.. ....+... . .....++|+|+|+++++-..++
T Consensus 173 g~--~~e~~a~G---~-rnp~Gl~~d~~G~l~~tdn~~~ 205 (367)
T TIGR02604 173 GG--KLRVVAHG---F-QNPYGHSVDSWGDVFFCDNDDP 205 (367)
T ss_pred CC--eEEEEecC---c-CCCccceECCCCCEEEEccCCC
Confidence 11 12222111 1 1357899999999887655444
No 383
>KOG4499 consensus Ca2+-binding protein Regucalcin/SMP30 [Inorganic ion transport and metabolism; Signal transduction mechanisms]
Probab=96.04 E-value=0.15 Score=43.24 Aligned_cols=92 Identities=11% Similarity=0.073 Sum_probs=62.6
Q ss_pred ceeEEEEcCCCCEEEE-EeCCCeEEEEe--CCCCc-----ceEEeec----CCCCeEEEEEecCCCEEEEecCCCeEEEE
Q 040274 69 RTDLMRVNPFNGVVSL-GHSGGTVTMWK--PTTSA-----LLIKMLY----HQGPVSALAFHPNGHLMATTGKECKIKIW 136 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~t-g~~dg~v~lwd--~~~~~-----~~~~~~~----h~~~v~~l~~~p~g~~l~s~~~d~~i~vw 136 (359)
--+.++|+.+.+.++. -+.+-+|.-|| ..+|. .+..+.. ..-.--.++...+|++++++-..++|...
T Consensus 159 IsNgl~Wd~d~K~fY~iDsln~~V~a~dyd~~tG~~snr~~i~dlrk~~~~e~~~PDGm~ID~eG~L~Va~~ng~~V~~~ 238 (310)
T KOG4499|consen 159 ISNGLAWDSDAKKFYYIDSLNYEVDAYDYDCPTGDLSNRKVIFDLRKSQPFESLEPDGMTIDTEGNLYVATFNGGTVQKV 238 (310)
T ss_pred CCccccccccCcEEEEEccCceEEeeeecCCCcccccCcceeEEeccCCCcCCCCCCcceEccCCcEEEEEecCcEEEEE
Confidence 3477889887765554 45567887787 55553 2222221 01111345556788999998899999999
Q ss_pred EcCCCeeeEee---cCCceeEEEcCCC
Q 040274 137 DLRKYEVLQTL---TGHAKTLDFSQKG 160 (359)
Q Consensus 137 d~~~~~~~~~~---~~~v~~~~~s~~g 160 (359)
|..+|+.+.++ ...++|+||-...
T Consensus 239 dp~tGK~L~eiklPt~qitsccFgGkn 265 (310)
T KOG4499|consen 239 DPTTGKILLEIKLPTPQITSCCFGGKN 265 (310)
T ss_pred CCCCCcEEEEEEcCCCceEEEEecCCC
Confidence 99999999888 3458999997653
No 384
>COG3386 Gluconolactonase [Carbohydrate transport and metabolism]
Probab=95.87 E-value=0.63 Score=41.99 Aligned_cols=89 Identities=8% Similarity=0.132 Sum_probs=61.2
Q ss_pred ceeEEEEcCCCCEEEEEeCC-CeEEEEeCCC--C---cc--eEEeecCCCCeEEEEEecCCCEEEEecCCC-eEEEEEcC
Q 040274 69 RTDLMRVNPFNGVVSLGHSG-GTVTMWKPTT--S---AL--LIKMLYHQGPVSALAFHPNGHLMATTGKEC-KIKIWDLR 139 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~d-g~v~lwd~~~--~---~~--~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~-~i~vwd~~ 139 (359)
.-+.|+||||++.|+.+... +.|..|++.. + .. ...+..+.+..-.++...+|++.+++..+| .|.+|+..
T Consensus 164 ~~NGla~SpDg~tly~aDT~~~~i~r~~~d~~~g~~~~~~~~~~~~~~~G~PDG~~vDadG~lw~~a~~~g~~v~~~~pd 243 (307)
T COG3386 164 IPNGLAFSPDGKTLYVADTPANRIHRYDLDPATGPIGGRRGFVDFDEEPGLPDGMAVDADGNLWVAAVWGGGRVVRFNPD 243 (307)
T ss_pred ecCceEECCCCCEEEEEeCCCCeEEEEecCcccCccCCcceEEEccCCCCCCCceEEeCCCCEEEecccCCceEEEECCC
Confidence 45889999999888777654 7788887652 2 11 112223345566778888898876555554 89999988
Q ss_pred CCeeeEeec---CCceeEEEcC
Q 040274 140 KYEVLQTLT---GHAKTLDFSQ 158 (359)
Q Consensus 140 ~~~~~~~~~---~~v~~~~~s~ 158 (359)
++.+..+. ..+++++|--
T Consensus 244 -G~l~~~i~lP~~~~t~~~FgG 264 (307)
T COG3386 244 -GKLLGEIKLPVKRPTNPAFGG 264 (307)
T ss_pred -CcEEEEEECCCCCCccceEeC
Confidence 88887773 4467888754
No 385
>KOG4649 consensus PQQ (pyrrolo-quinoline quinone) repeat protein [Secondary metabolites biosynthesis, transport and catabolism]
Probab=95.79 E-value=1.1 Score=38.67 Aligned_cols=98 Identities=10% Similarity=0.082 Sum_probs=68.9
Q ss_pred CCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee--cCCc-eeEE
Q 040274 79 NGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL--TGHA-KTLD 155 (359)
Q Consensus 79 ~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v-~~~~ 155 (359)
..+++.|+..+.+.--|+.+|.....-.. ...+-+-+.- -|.+++.|+..|.+++.+..+|.....+ -+.| ....
T Consensus 23 kT~v~igSHs~~~~avd~~sG~~~We~il-g~RiE~sa~v-vgdfVV~GCy~g~lYfl~~~tGs~~w~f~~~~~vk~~a~ 100 (354)
T KOG4649|consen 23 KTLVVIGSHSGIVIAVDPQSGNLIWEAIL-GVRIECSAIV-VGDFVVLGCYSGGLYFLCVKTGSQIWNFVILETVKVRAQ 100 (354)
T ss_pred ceEEEEecCCceEEEecCCCCcEEeehhh-CceeeeeeEE-ECCEEEEEEccCcEEEEEecchhheeeeeehhhhccceE
Confidence 45788888889999999999877655322 2223222221 4678999999999999999999877766 2333 2334
Q ss_pred EcCCC--cEEEEcCCcEEEEcCCCC
Q 040274 156 FSQKG--LLAVGTGSFAQILGDFSG 178 (359)
Q Consensus 156 ~s~~g--l~~~~~d~~i~v~d~~~~ 178 (359)
..+++ ++.++.|++.+..|..+.
T Consensus 101 ~d~~~glIycgshd~~~yalD~~~~ 125 (354)
T KOG4649|consen 101 CDFDGGLIYCGSHDGNFYALDPKTY 125 (354)
T ss_pred EcCCCceEEEecCCCcEEEeccccc
Confidence 45565 778888999999996554
No 386
>PF14655 RAB3GAP2_N: Rab3 GTPase-activating protein regulatory subunit N-terminus
Probab=95.78 E-value=1.1 Score=41.99 Aligned_cols=42 Identities=26% Similarity=0.472 Sum_probs=31.8
Q ss_pred CCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEec
Q 040274 77 PFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHP 119 (359)
Q Consensus 77 p~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p 119 (359)
+|...|+.|..+|.|++|.. +|..+..-.-|..+|..+.+..
T Consensus 77 ~dw~~I~VG~ssG~vrfyte-~G~LL~~Q~~h~~pV~~ik~~~ 118 (415)
T PF14655_consen 77 PDWTCIAVGTSSGYVRFYTE-NGVLLLSQLLHEEPVLKIKCRS 118 (415)
T ss_pred CCcEEEEEEecccEEEEEec-cchHHHHHhcCccceEEEEecc
Confidence 34568999999999999986 4666655556788888877743
No 387
>COG3490 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=95.72 E-value=0.33 Score=42.42 Aligned_cols=92 Identities=9% Similarity=0.143 Sum_probs=65.3
Q ss_pred EEcCCCCEEEEEeCC-----CeEEEEeCCCC-cceEEeecCCCCeEEEEEecCCCEEEEecC------C-----------
Q 040274 74 RVNPFNGVVSLGHSG-----GTVTMWKPTTS-ALLIKMLYHQGPVSALAFHPNGHLMATTGK------E----------- 130 (359)
Q Consensus 74 ~~sp~~~~l~tg~~d-----g~v~lwd~~~~-~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~------d----------- 130 (359)
.|||||.+|+..-+| |.|-|||.+.+ +.+..+..|.-.-..+.|.+||+.|+.++. |
T Consensus 120 vfs~dG~~LYATEndfd~~rGViGvYd~r~~fqrvgE~~t~GiGpHev~lm~DGrtlvvanGGIethpdfgR~~lNldsM 199 (366)
T COG3490 120 VFSPDGRLLYATENDFDPNRGVIGVYDAREGFQRVGEFSTHGIGPHEVTLMADGRTLVVANGGIETHPDFGRTELNLDSM 199 (366)
T ss_pred ccCCCCcEEEeecCCCCCCCceEEEEecccccceecccccCCcCcceeEEecCCcEEEEeCCceecccccCccccchhhc
Confidence 489999998876543 68999998854 456667788877789999999999887654 1
Q ss_pred -CeEEEEEcCCCeeeEee--c-----CCceeEEEcCCC-cEEEE
Q 040274 131 -CKIKIWDLRKYEVLQTL--T-----GHAKTLDFSQKG-LLAVG 165 (359)
Q Consensus 131 -~~i~vwd~~~~~~~~~~--~-----~~v~~~~~s~~g-l~~~~ 165 (359)
.++.+.|..+|..+... + -.+..++..+|| +++++
T Consensus 200 ePSlvlld~atG~liekh~Lp~~l~~lSiRHld~g~dgtvwfgc 243 (366)
T COG3490 200 EPSLVLLDAATGNLIEKHTLPASLRQLSIRHLDIGRDGTVWFGC 243 (366)
T ss_pred CccEEEEeccccchhhhccCchhhhhcceeeeeeCCCCcEEEEE
Confidence 23555666666655443 2 236778888888 55544
No 388
>PF10647 Gmad1: Lipoprotein LpqB beta-propeller domain; InterPro: IPR018910 The Gmad1 domain is found associated with IPR019606 from INTERPRO, in bacterial spore formation. It is predicted to have a beta-propeller fold and to have a passive binding role rather than a catalytic function owing to the low number of conserved hydrophilic residues.
Probab=95.70 E-value=0.38 Score=42.19 Aligned_cols=100 Identities=12% Similarity=0.064 Sum_probs=58.6
Q ss_pred CeEEEEEecCCCEEEEec---CCCeEEEEEcCCCeeeEeecCCceeEEEcCCC-cEEEEc-CCcEEEEc-CCCCCccccc
Q 040274 111 PVSALAFHPNGHLMATTG---KECKIKIWDLRKYEVLQTLTGHAKTLDFSQKG-LLAVGT-GSFAQILG-DFSGSHNYSR 184 (359)
Q Consensus 111 ~v~~l~~~p~g~~l~s~~---~d~~i~vwd~~~~~~~~~~~~~v~~~~~s~~g-l~~~~~-d~~i~v~d-~~~~~~~~~~ 184 (359)
.+.+.+++++|..++... ....++++..............++...|+++| ++++.. +....++. ...+......
T Consensus 25 ~~~s~AvS~dg~~~A~v~~~~~~~~L~~~~~~~~~~~~~~g~~l~~PS~d~~g~~W~v~~~~~~~~~~~~~~~g~~~~~~ 104 (253)
T PF10647_consen 25 DVTSPAVSPDGSRVAAVSEGDGGRSLYVGPAGGPVRPVLTGGSLTRPSWDPDGWVWTVDDGSGGVRVVRDSASGTGEPVE 104 (253)
T ss_pred cccceEECCCCCeEEEEEEcCCCCEEEEEcCCCcceeeccCCccccccccCCCCEEEEEcCCCceEEEEecCCCcceeEE
Confidence 688999999999877665 33456666543222111123467888999999 555544 44445552 2222111111
Q ss_pred cccccCCCCcceeEEEEccCCCEEEEEe
Q 040274 185 YMGNSMVKGYQIGKVSFRPYEDVLGIGH 212 (359)
Q Consensus 185 ~~~~~~~~~~~v~~~~~sp~~~~l~~g~ 212 (359)
..... ....|.++.+||||..++.-.
T Consensus 105 v~~~~--~~~~I~~l~vSpDG~RvA~v~ 130 (253)
T PF10647_consen 105 VDWPG--LRGRITALRVSPDGTRVAVVV 130 (253)
T ss_pred ecccc--cCCceEEEEECCCCcEEEEEE
Confidence 22111 111699999999998877665
No 389
>KOG2377 consensus Uncharacterized conserved protein [Function unknown]
Probab=95.64 E-value=0.46 Score=44.25 Aligned_cols=138 Identities=7% Similarity=0.047 Sum_probs=85.9
Q ss_pred eEEEEcCCCCEEEEEeCCCeEEEEeCCC---CcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee
Q 040274 71 DLMRVNPFNGVVSLGHSGGTVTMWKPTT---SALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL 147 (359)
Q Consensus 71 ~~l~~sp~~~~l~tg~~dg~v~lwd~~~---~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~ 147 (359)
+.+-|...++.|++.. .|.+.=|-+.. .-++.--....|+|.++.|++|...+|.--.|..|.+++....+....+
T Consensus 26 ngvFfDDaNkqlfavr-SggatgvvvkgpndDVpiSfdm~d~G~I~SIkFSlDnkilAVQR~~~~v~f~nf~~d~~~l~~ 104 (657)
T KOG2377|consen 26 NGVFFDDANKQLFAVR-SGGATGVVVKGPNDDVPISFDMDDKGEIKSIKFSLDNKILAVQRTSKTVDFCNFIPDNSQLEY 104 (657)
T ss_pred cceeeccCcceEEEEe-cCCeeEEEEeCCCCCCCceeeecCCCceeEEEeccCcceEEEEecCceEEEEecCCCchhhHH
Confidence 4455555454444332 34444454332 2222222245679999999999999999999999999988543332222
Q ss_pred -------cCCceeEEEcCCCcEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeC
Q 040274 148 -------TGHAKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHS 213 (359)
Q Consensus 148 -------~~~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~ 213 (359)
...|..++|+.+.-++.-.+..+.+|-+......+.....+.. .|.=..|+|+.+.++.++.
T Consensus 105 ~~~ck~k~~~IlGF~W~~s~e~A~i~~~G~e~y~v~pekrslRlVks~~~----nvnWy~yc~et~v~LL~t~ 173 (657)
T KOG2377|consen 105 TQECKTKNANILGFCWTSSTEIAFITDQGIEFYQVLPEKRSLRLVKSHNL----NVNWYMYCPETAVILLSTT 173 (657)
T ss_pred HHHhccCcceeEEEEEecCeeEEEEecCCeEEEEEchhhhhhhhhhhccc----CccEEEEccccceEeeecc
Confidence 2347889998887333334445677765555455666666654 6777888998877665544
No 390
>PRK10115 protease 2; Provisional
Probab=95.61 E-value=3 Score=42.29 Aligned_cols=167 Identities=8% Similarity=-0.054 Sum_probs=87.4
Q ss_pred eEEEECCCCCEEEEecc-------------------------c-eeEEEEcCCCCEEEEEeCC------CeEEEEeCCCC
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------R-TDLMRVNPFNGVVSLGHSG------GTVTMWKPTTS 99 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------~-v~~l~~sp~~~~l~tg~~d------g~v~lwd~~~~ 99 (359)
..+.+||||++|+.+.+ . -..++|++|+..|+.+..+ ..|..|++.++
T Consensus 130 ~~~~~Spdg~~la~~~d~~G~E~~~l~v~d~~tg~~l~~~i~~~~~~~~w~~D~~~~~y~~~~~~~~~~~~v~~h~lgt~ 209 (686)
T PRK10115 130 GGMAITPDNTIMALAEDFLSRRQYGIRFRNLETGNWYPELLDNVEPSFVWANDSWTFYYVRKHPVTLLPYQVWRHTIGTP 209 (686)
T ss_pred eEEEECCCCCEEEEEecCCCcEEEEEEEEECCCCCCCCccccCcceEEEEeeCCCEEEEEEecCCCCCCCEEEEEECCCC
Confidence 45678999999998765 1 1469999998876665432 36888888887
Q ss_pred --cceEEeecCCCCeE-EEEEecCCCEEEEecC---CCeEEEEEcC--CCeeeEee--c-CCceeEEEcCCC-cEEEEc-
Q 040274 100 --ALLIKMLYHQGPVS-ALAFHPNGHLMATTGK---ECKIKIWDLR--KYEVLQTL--T-GHAKTLDFSQKG-LLAVGT- 166 (359)
Q Consensus 100 --~~~~~~~~h~~~v~-~l~~~p~g~~l~s~~~---d~~i~vwd~~--~~~~~~~~--~-~~v~~~~~s~~g-l~~~~~- 166 (359)
+-...+........ ++..+.++.+++..+. ++.+.+|+.. .+.....+ . +....+. +..+ ++..+.
T Consensus 210 ~~~d~lv~~e~~~~~~~~~~~s~d~~~l~i~~~~~~~~~~~l~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~ly~~tn~ 288 (686)
T PRK10115 210 ASQDELVYEEKDDTFYVSLHKTTSKHYVVIHLASATTSEVLLLDAELADAEPFVFLPRRKDHEYSLD-HYQHRFYLRSNR 288 (686)
T ss_pred hhHCeEEEeeCCCCEEEEEEEcCCCCEEEEEEECCccccEEEEECcCCCCCceEEEECCCCCEEEEE-eCCCEEEEEEcC
Confidence 33344443333333 2333447777554433 4568888853 33322222 2 2222222 2223 333332
Q ss_pred C-C--cEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcC
Q 040274 167 G-S--FAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPR 223 (359)
Q Consensus 167 d-~--~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~g 223 (359)
+ . .|...++... .....+..+. ....|..+.++ .+.++++...+|...+++-.
T Consensus 289 ~~~~~~l~~~~~~~~-~~~~~l~~~~--~~~~i~~~~~~-~~~l~~~~~~~g~~~l~~~~ 344 (686)
T PRK10115 289 HGKNFGLYRTRVRDE-QQWEELIPPR--ENIMLEGFTLF-TDWLVVEERQRGLTSLRQIN 344 (686)
T ss_pred CCCCceEEEecCCCc-ccCeEEECCC--CCCEEEEEEEE-CCEEEEEEEeCCEEEEEEEc
Confidence 2 2 3333343221 1222333331 12357777776 33455566667776665543
No 391
>PF10168 Nup88: Nuclear pore component; InterPro: IPR019321 Nup88 can be divided into two structural domains; the N-terminal two-thirds of the protein have no obvious structural motifs. It is, however, where it binds to Nup98; one of the components of the nuclear pore. The C-terminal end is a predicted coiled-coil domain []. Nup88 is over expressed in tumour cells [].
Probab=95.42 E-value=1.3 Score=44.73 Aligned_cols=73 Identities=12% Similarity=0.233 Sum_probs=50.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCC---------Ccc--e-EEe--------ecCCCCeEEEEEecC---CCEEE
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTT---------SAL--L-IKM--------LYHQGPVSALAFHPN---GHLMA 125 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~---------~~~--~-~~~--------~~h~~~v~~l~~~p~---g~~l~ 125 (359)
.|..+.+||+|.+++..+..|.+.+.=+.. |.. . .++ ..+...|..+.|+|. +..|+
T Consensus 86 ~v~~i~~n~~g~~lal~G~~~v~V~~LP~r~g~~~~~~~g~~~i~Crt~~v~~~~~~~~~~~~i~qv~WhP~s~~~~~l~ 165 (717)
T PF10168_consen 86 EVHQISLNPTGSLLALVGPRGVVVLELPRRWGKNGEFEDGKKEINCRTVPVDERFFTSNSSLEIKQVRWHPWSESDSHLV 165 (717)
T ss_pred eEEEEEECCCCCEEEEEcCCcEEEEEeccccCccccccCCCcceeEEEEEechhhccCCCCceEEEEEEcCCCCCCCeEE
Confidence 788888899888888887766544432221 111 1 111 123457889999995 57899
Q ss_pred EecCCCeEEEEEcCCC
Q 040274 126 TTGKECKIKIWDLRKY 141 (359)
Q Consensus 126 s~~~d~~i~vwd~~~~ 141 (359)
.-+.|+++++||+...
T Consensus 166 vLtsdn~lR~y~~~~~ 181 (717)
T PF10168_consen 166 VLTSDNTLRLYDISDP 181 (717)
T ss_pred EEecCCEEEEEecCCC
Confidence 9999999999999753
No 392
>COG4257 Vgb Streptogramin lyase [Defense mechanisms]
Probab=95.37 E-value=0.94 Score=39.54 Aligned_cols=132 Identities=17% Similarity=0.078 Sum_probs=84.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeee-Eee
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVL-QTL 147 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~-~~~ 147 (359)
.-..++-+|||..-+++...|.|--.|+.+|+....-.+....-+.+...|||..-++-+.. -|.-.|..+.+.. ..+
T Consensus 63 ap~dvapapdG~VWft~qg~gaiGhLdP~tGev~~ypLg~Ga~Phgiv~gpdg~~Witd~~~-aI~R~dpkt~evt~f~l 141 (353)
T COG4257 63 APFDVAPAPDGAVWFTAQGTGAIGHLDPATGEVETYPLGSGASPHGIVVGPDGSAWITDTGL-AIGRLDPKTLEVTRFPL 141 (353)
T ss_pred CccccccCCCCceEEecCccccceecCCCCCceEEEecCCCCCCceEEECCCCCeeEecCcc-eeEEecCcccceEEeec
Confidence 45677788899888888888888888999998665555555666788889999877664443 5666676555431 122
Q ss_pred -----cCCceeEEEcCCC-cEEEEcC----------CcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEE
Q 040274 148 -----TGHAKTLDFSQKG-LLAVGTG----------SFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIG 211 (359)
Q Consensus 148 -----~~~v~~~~~s~~g-l~~~~~d----------~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g 211 (359)
.+......|.+.| +...+.. +.|.+|+... +...+.++..|+|.+-++.
T Consensus 142 p~~~a~~nlet~vfD~~G~lWFt~q~G~yGrLdPa~~~i~vfpaPq---------------G~gpyGi~atpdGsvwyas 206 (353)
T COG4257 142 PLEHADANLETAVFDPWGNLWFTGQIGAYGRLDPARNVISVFPAPQ---------------GGGPYGICATPDGSVWYAS 206 (353)
T ss_pred ccccCCCcccceeeCCCccEEEeeccccceecCcccCceeeeccCC---------------CCCCcceEECCCCcEEEEe
Confidence 2346788999999 4444332 2444444322 2234556667777665554
Q ss_pred eCCCe
Q 040274 212 HSMGW 216 (359)
Q Consensus 212 ~~dg~ 216 (359)
-.+..
T Consensus 207 lagna 211 (353)
T COG4257 207 LAGNA 211 (353)
T ss_pred ccccc
Confidence 44443
No 393
>PF12234 Rav1p_C: RAVE protein 1 C terminal; InterPro: IPR022033 This domain family is found in eukaryotes, and is typically between 621 and 644 amino acids in length. This family is the C-terminal region of the protein RAVE (regulator of the ATPase of vacuolar and endosomal membranes). Rav1p is involved in regulating the glucose dependent assembly and disassembly of vacuolar ATPase V1 and V0 subunits.
Probab=95.36 E-value=0.34 Score=47.70 Aligned_cols=99 Identities=14% Similarity=0.214 Sum_probs=61.2
Q ss_pred CeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeE--ee--cCCceeEEEcC--CC--cEEEEcCCcEEEEcCC-----C
Q 040274 111 PVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQ--TL--TGHAKTLDFSQ--KG--LLAVGTGSFAQILGDF-----S 177 (359)
Q Consensus 111 ~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~--~~--~~~v~~~~~s~--~g--l~~~~~d~~i~v~d~~-----~ 177 (359)
...-+.-+.-++..++-+....+.|||.+.+.... .+ .+.|.+++|.. +| ++++|..+.|.+|--. .
T Consensus 31 ~~~li~gss~~k~a~V~~~~~~LtIWD~~~~~lE~~~~f~~~~~I~dLDWtst~d~qsiLaVGf~~~v~l~~Q~R~dy~~ 110 (631)
T PF12234_consen 31 NPSLISGSSIKKIAVVDSSRSELTIWDTRSGVLEYEESFSEDDPIRDLDWTSTPDGQSILAVGFPHHVLLYTQLRYDYTN 110 (631)
T ss_pred CcceEeecccCcEEEEECCCCEEEEEEcCCcEEEEeeeecCCCceeeceeeecCCCCEEEEEEcCcEEEEEEccchhhhc
Confidence 34444444545444444445679999999876433 33 56789999864 55 9999999999998521 1
Q ss_pred CCcccccc-----ccccCCCCcceeEEEEccCCCEEEEEe
Q 040274 178 GSHNYSRY-----MGNSMVKGYQIGKVSFRPYEDVLGIGH 212 (359)
Q Consensus 178 ~~~~~~~~-----~~~~~~~~~~v~~~~~sp~~~~l~~g~ 212 (359)
.......+ ..+ ...+|.+..|.++|.+++.++
T Consensus 111 ~~p~w~~i~~i~i~~~---T~h~Igds~Wl~~G~LvV~sG 147 (631)
T PF12234_consen 111 KGPSWAPIRKIDISSH---TPHPIGDSIWLKDGTLVVGSG 147 (631)
T ss_pred CCcccceeEEEEeecC---CCCCccceeEecCCeEEEEeC
Confidence 11111111 122 223788999999987555443
No 394
>PF04841 Vps16_N: Vps16, N-terminal region; InterPro: IPR006926 This protein forms part of the Class C vacuolar protein sorting (Vps) complex. Vps16 is essential for vacuolar protein sorting, which is essential for viability in plants, but not yeast []. The Class C Vps complex is required for SNARE-mediated membrane fusion at the lysosome-like yeast vacuole. It is thought to play essential roles in membrane docking and fusion at the Golgi-to-endosome and endosome-to-vacuole stages of transport []. The role of VPS16 in this complex is not known.; GO: 0006886 intracellular protein transport, 0005737 cytoplasm
Probab=95.35 E-value=1.2 Score=42.05 Aligned_cols=66 Identities=17% Similarity=0.265 Sum_probs=48.3
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee----cCCceeEEEcCCCcEEEEcCCcEEEEc
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL----TGHAKTLDFSQKGLLAVGTGSFAQILG 174 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~----~~~v~~~~~s~~gl~~~~~d~~i~v~d 174 (359)
.+++..+++||+|+++|.-..+|.+.+....-.+.+..+ ...+..+.|+.+..++......|.++.
T Consensus 216 ~~~i~~iavSpng~~iAl~t~~g~l~v~ssDf~~~~~e~~~~~~~~p~~~~WCG~dav~l~~~~~l~lvg 285 (410)
T PF04841_consen 216 DGPIIKIAVSPNGKFIALFTDSGNLWVVSSDFSEKLCEFDTDSKSPPKQMAWCGNDAVVLSWEDELLLVG 285 (410)
T ss_pred CCCeEEEEECCCCCEEEEEECCCCEEEEECcccceeEEeecCcCCCCcEEEEECCCcEEEEeCCEEEEEC
Confidence 468999999999999999999999999876655555555 245678888776644444455565554
No 395
>PLN00033 photosystem II stability/assembly factor; Provisional
Probab=95.32 E-value=2.2 Score=40.12 Aligned_cols=136 Identities=13% Similarity=0.143 Sum_probs=73.9
Q ss_pred EEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCe-----eeEee
Q 040274 73 MRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYE-----VLQTL 147 (359)
Q Consensus 73 l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~-----~~~~~ 147 (359)
+..++++.+++.|..-..++-||.-...-...-......++++.|.+++.+++++ .+|.+.. ....+. .....
T Consensus 244 v~~~~dG~~~~vg~~G~~~~s~d~G~~~W~~~~~~~~~~l~~v~~~~dg~l~l~g-~~G~l~~-S~d~G~~~~~~~f~~~ 321 (398)
T PLN00033 244 VNRSPDGDYVAVSSRGNFYLTWEPGQPYWQPHNRASARRIQNMGWRADGGLWLLT-RGGGLYV-SKGTGLTEEDFDFEEA 321 (398)
T ss_pred EEEcCCCCEEEEECCccEEEecCCCCcceEEecCCCccceeeeeEcCCCCEEEEe-CCceEEE-ecCCCCcccccceeec
Confidence 3445666666555433333334432110011112334568899999999877665 5565443 333332 22222
Q ss_pred c-----CCceeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeC
Q 040274 148 T-----GHAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHS 213 (359)
Q Consensus 148 ~-----~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~ 213 (359)
. ..+.++.|.+++ +++++..|.+.... ..+........... .....+.+.|.++++.+++|..
T Consensus 322 ~~~~~~~~l~~v~~~~d~~~~a~G~~G~v~~s~--D~G~tW~~~~~~~~-~~~~ly~v~f~~~~~g~~~G~~ 390 (398)
T PLN00033 322 DIKSRGFGILDVGYRSKKEAWAAGGSGILLRST--DGGKSWKRDKGADN-IAANLYSVKFFDDKKGFVLGND 390 (398)
T ss_pred ccCCCCcceEEEEEcCCCcEEEEECCCcEEEeC--CCCcceeEccccCC-CCcceeEEEEcCCCceEEEeCC
Confidence 1 237889999888 88888888777664 23333333221111 1225789999887776665543
No 396
>KOG2395 consensus Protein involved in vacuole import and degradation [Intracellular trafficking, secretion, and vesicular transport]
Probab=95.30 E-value=0.14 Score=48.30 Aligned_cols=108 Identities=16% Similarity=0.235 Sum_probs=73.2
Q ss_pred ceeEEEEcCCCCE-------EEEEeCCCeEEEEeCCCCcc--eEEeecCC----CCeEEEEEecCCCEEEEecCCCeEEE
Q 040274 69 RTDLMRVNPFNGV-------VSLGHSGGTVTMWKPTTSAL--LIKMLYHQ----GPVSALAFHPNGHLMATTGKECKIKI 135 (359)
Q Consensus 69 ~v~~l~~sp~~~~-------l~tg~~dg~v~lwd~~~~~~--~~~~~~h~----~~v~~l~~~p~g~~l~s~~~d~~i~v 135 (359)
.|+-+.+.|++.. -+.|-.|..|+-||++-... +....+|. ....|.+-..+| +++.||.+|.|++
T Consensus 377 di~mv~~t~d~K~~Ql~~e~TlvGLs~n~vfriDpRv~~~~kl~~~q~kqy~~k~nFsc~aTT~sG-~IvvgS~~GdIRL 455 (644)
T KOG2395|consen 377 DINMVDITPDFKFAQLTSEQTLVGLSDNSVFRIDPRVQGKNKLAVVQSKQYSTKNNFSCFATTESG-YIVVGSLKGDIRL 455 (644)
T ss_pred CcceeeccCCcchhcccccccEEeecCCceEEecccccCcceeeeeeccccccccccceeeecCCc-eEEEeecCCcEEe
Confidence 6777788886542 24566788999999884322 22222332 234455544455 8999999999999
Q ss_pred EEcCCCe---eeEeecCCceeEEEcCCC-cEEEEcCCcEEEEcCCC
Q 040274 136 WDLRKYE---VLQTLTGHAKTLDFSQKG-LLAVGTGSFAQILGDFS 177 (359)
Q Consensus 136 wd~~~~~---~~~~~~~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~ 177 (359)
||-..-. .+-.+..+|..+..+.+| ++.+..+.++.+.++..
T Consensus 456 Ydri~~~AKTAlPgLG~~I~hVdvtadGKwil~Tc~tyLlLi~t~~ 501 (644)
T KOG2395|consen 456 YDRIGRRAKTALPGLGDAIKHVDVTADGKWILATCKTYLLLIDTLI 501 (644)
T ss_pred ehhhhhhhhhcccccCCceeeEEeeccCcEEEEecccEEEEEEEec
Confidence 9973222 333345679999999999 88888888888887543
No 397
>PF14781 BBS2_N: Ciliary BBSome complex subunit 2, N-terminal
Probab=95.27 E-value=0.68 Score=35.83 Aligned_cols=102 Identities=14% Similarity=0.201 Sum_probs=65.5
Q ss_pred eEEEEcCCCCEEEEEeCCCeEEEEeCCCCc--------ceEEeecCCCCeEEEEEec----C-CCEEEEecCCCeEEEEE
Q 040274 71 DLMRVNPFNGVVSLGHSGGTVTMWKPTTSA--------LLIKMLYHQGPVSALAFHP----N-GHLMATTGKECKIKIWD 137 (359)
Q Consensus 71 ~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~--------~~~~~~~h~~~v~~l~~~p----~-g~~l~s~~~d~~i~vwd 137 (359)
..-.|......|++++.-|.|.|+++.... .+..+ .-...|++++-.+ + ...|+. +...+|-.||
T Consensus 2 aiGkfDG~~pcL~~aT~~gKV~IH~ph~~~~~~~~~~~~i~~L-Nin~~italaaG~l~~~~~~D~Lli-Gt~t~llaYD 79 (136)
T PF14781_consen 2 AIGKFDGVHPCLACATTGGKVFIHNPHERGQRTGRQDSDISFL-NINQEITALAAGRLKPDDGRDCLLI-GTQTSLLAYD 79 (136)
T ss_pred eEEEeCCCceeEEEEecCCEEEEECCCccccccccccCceeEE-ECCCceEEEEEEecCCCCCcCEEEE-eccceEEEEE
Confidence 344577777789999999999999987432 22333 3356677776544 2 233444 4556799999
Q ss_pred cCCCeeeE--eecCCceeEEEcCC-----CcEEEEcCCcEEEEc
Q 040274 138 LRKYEVLQ--TLTGHAKTLDFSQK-----GLLAVGTGSFAQILG 174 (359)
Q Consensus 138 ~~~~~~~~--~~~~~v~~~~~s~~-----gl~~~~~d~~i~v~d 174 (359)
+....-+. .+++.++++.+-.- -++.++.+..|.-||
T Consensus 80 V~~N~d~Fyke~~DGvn~i~~g~~~~~~~~l~ivGGncsi~Gfd 123 (136)
T PF14781_consen 80 VENNSDLFYKEVPDGVNAIVIGKLGDIPSPLVIVGGNCSIQGFD 123 (136)
T ss_pred cccCchhhhhhCccceeEEEEEecCCCCCcEEEECceEEEEEeC
Confidence 98765432 33666777766321 267777677777777
No 398
>KOG3630 consensus Nuclear pore complex, Nup214/CAN component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=95.24 E-value=0.18 Score=51.78 Aligned_cols=107 Identities=10% Similarity=0.009 Sum_probs=70.4
Q ss_pred CCeEEEEEecCCCEEEEe--cCCCeEEEEEcCCCee--------eEee------cCCceeEEEcCCC---cEEEEcCCcE
Q 040274 110 GPVSALAFHPNGHLMATT--GKECKIKIWDLRKYEV--------LQTL------TGHAKTLDFSQKG---LLAVGTGSFA 170 (359)
Q Consensus 110 ~~v~~l~~~p~g~~l~s~--~~d~~i~vwd~~~~~~--------~~~~------~~~v~~~~~s~~g---l~~~~~d~~i 170 (359)
-++..+.+++|+...++. +.+-.|..||+++... +... .....++.|.|.- .+++..|+.|
T Consensus 101 ~pi~~~v~~~D~t~s~v~~tsng~~v~~fD~~~fs~s~~~~~~pl~~s~ts~ek~vf~~~~~wnP~vp~n~av~l~dlsl 180 (1405)
T KOG3630|consen 101 IPIVIFVCFHDATDSVVVSTSNGEAVYSFDLEEFSESRYETTVPLKNSATSFEKPVFQLKNVWNPLVPLNSAVDLSDLSL 180 (1405)
T ss_pred ccceEEEeccCCceEEEEEecCCceEEEEehHhhhhhhhhhccccccccchhccccccccccccCCccchhhhhccccch
Confidence 456666777787664443 3445799999976321 1111 1235788899876 5667778889
Q ss_pred EEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEE
Q 040274 171 QILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILV 221 (359)
Q Consensus 171 ~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~ 221 (359)
.|..+.........+. ....+++++|+|.|..|++|-..|.+.=|.
T Consensus 181 ~V~~~~~~~~~v~s~p-----~t~~~Tav~WSprGKQl~iG~nnGt~vQy~ 226 (1405)
T KOG3630|consen 181 RVKSTKQLAQNVTSFP-----VTNSQTAVLWSPRGKQLFIGRNNGTEVQYE 226 (1405)
T ss_pred hhhhhhhhhhhhcccC-----cccceeeEEeccccceeeEecCCCeEEEee
Confidence 8887543322222222 233689999999999999999999865443
No 399
>PF08596 Lgl_C: Lethal giant larvae(Lgl) like, C-terminal; InterPro: IPR013905 The Lethal giant larvae (Lgl) tumour suppressor protein is conserved from yeast to mammals. The Lgl protein functions in cell polarity, at least in part, by regulating SNARE-mediated membrane delivery events at the cell surface []. The N-terminal half of Lgl members contains WD40 repeats (see IPR001680 from INTERPRO), while the C-terminal half appears specific to the protein []. ; PDB: 2OAJ_A.
Probab=95.00 E-value=1.7 Score=40.86 Aligned_cols=146 Identities=10% Similarity=0.088 Sum_probs=83.6
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee--c------CCCCeEEEEEec-----CC---CEEEEecCCCe
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML--Y------HQGPVSALAFHP-----NG---HLMATTGKECK 132 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~--~------h~~~v~~l~~~p-----~g---~~l~s~~~d~~ 132 (359)
.|++++.| +=.+++.|..+|.+.|.|++....+..-. . ....|+++.|.- |+ -+|++|...|.
T Consensus 88 ~vtal~~S-~iGFvaigy~~G~l~viD~RGPavI~~~~i~~~~~~~~~~~~vt~ieF~vm~~~~D~ySSi~L~vGTn~G~ 166 (395)
T PF08596_consen 88 PVTALKNS-DIGFVAIGYESGSLVVIDLRGPAVIYNENIRESFLSKSSSSYVTSIEFSVMTLGGDGYSSICLLVGTNSGN 166 (395)
T ss_dssp SEEEEEE--BTSEEEEEETTSEEEEEETTTTEEEEEEEGGG--T-SS----EEEEEEEEEE-TTSSSEEEEEEEEETTSE
T ss_pred cEeEEecC-CCcEEEEEecCCcEEEEECCCCeEEeeccccccccccccccCeeEEEEEEEecCCCcccceEEEEEeCCCC
Confidence 79999987 44599999999999999998776665422 1 234678888863 33 46888889999
Q ss_pred EEEEEcCC---CeeeEee-------cCCceeEE-EcC----------------------CCcEEEEcCCcEEEEcCCCCC
Q 040274 133 IKIWDLRK---YEVLQTL-------TGHAKTLD-FSQ----------------------KGLLAVGTGSFAQILGDFSGS 179 (359)
Q Consensus 133 i~vwd~~~---~~~~~~~-------~~~v~~~~-~s~----------------------~gl~~~~~d~~i~v~d~~~~~ 179 (359)
+.+|.+.. +.....+ .+.+..+. ++. .|++.++.+..++|+...+..
T Consensus 167 v~~fkIlp~~~g~f~v~~~~~~~~~~~~i~~I~~i~~~~G~~a~At~~~~~~l~~g~~i~g~vVvvSe~~irv~~~~~~k 246 (395)
T PF08596_consen 167 VLTFKILPSSNGRFSVQFAGATTNHDSPILSIIPINADTGESALATISAMQGLSKGISIPGYVVVVSESDIRVFKPPKSK 246 (395)
T ss_dssp EEEEEEEE-GGG-EEEEEEEEE--SS----EEEEEETTT--B-B-BHHHHHGGGGT----EEEEEE-SSEEEEE-TT---
T ss_pred EEEEEEecCCCCceEEEEeeccccCCCceEEEEEEECCCCCcccCchhHhhccccCCCcCcEEEEEcccceEEEeCCCCc
Confidence 99998752 1111111 22332222 211 125666677889999865543
Q ss_pred ccccccccccCCCCcceeEEEEc-----cCCCEEEEEeCCCeEEEE
Q 040274 180 HNYSRYMGNSMVKGYQIGKVSFR-----PYEDVLGIGHSMGWSGIL 220 (359)
Q Consensus 180 ~~~~~~~~~~~~~~~~v~~~~~s-----p~~~~l~~g~~dg~~~i~ 220 (359)
.....+ ... ..+..+.+- ..+..|++-..+|.+.++
T Consensus 247 ~~~K~~-~~~----~~~~~~~vv~~~~~~~~~~Lv~l~~~G~i~i~ 287 (395)
T PF08596_consen 247 GAHKSF-DDP----FLCSSASVVPTISRNGGYCLVCLFNNGSIRIY 287 (395)
T ss_dssp EEEEE--SS-----EEEEEEEEEEEE-EEEEEEEEEEETTSEEEEE
T ss_pred ccceee-ccc----cccceEEEEeecccCCceEEEEEECCCcEEEE
Confidence 222222 221 133444553 356778888888887775
No 400
>PF06433 Me-amine-dh_H: Methylamine dehydrogenase heavy chain (MADH); InterPro: IPR009451 Methylamine dehydrogenase (1.4.99.3 from EC) is a periplasmic quinoprotein found in several methyltrophic bacteria []. It is induced when grown on methylamine as a carbon source MADH and catalyses the oxidative deamination of amines to their corresponding aldehydes. The redox cofactor of this enzyme is tryptophan tryptophylquinone (TTQ). Electrons derived from the oxidation of methylamine are passed to an electron acceptor, which is usually the blue-copper protein amicyanin (IPR002386 from INTERPRO). RCH2NH2 + H2O + acceptor = RCHO + NH3 + reduced acceptor MADH is a hetero-tetramer, comprised of two heavy subunits and two light subunits. The heavy subunit forms a seven-bladed beta-propeller like structure [].; GO: 0030058 amine dehydrogenase activity, 0030416 methylamine metabolic process, 0055114 oxidation-reduction process, 0042597 periplasmic space; PDB: 3RN1_F 3SVW_F 3PXT_F 3L4O_F 3L4M_D 3SJL_F 3PXS_D 3ORV_F 3RMZ_F 3RLM_F ....
Probab=94.95 E-value=2.8 Score=38.06 Aligned_cols=168 Identities=12% Similarity=0.085 Sum_probs=94.0
Q ss_pred eEEEECCCCCEEEEecc---------------------ceeEEEEcC-CCCEEEEEeCCCeEEEEeCC-CCcceEEe---
Q 040274 52 ILWILPSSGRYMAVAGR---------------------RTDLMRVNP-FNGVVSLGHSGGTVTMWKPT-TSALLIKM--- 105 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~---------------------~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~-~~~~~~~~--- 105 (359)
..+.+|.||++++.... .--|...-| .+.-|.+-|.||++....+. .|+...+.
T Consensus 98 ~~~~ls~dgk~~~V~N~TPa~SVtVVDl~~~kvv~ei~~PGC~~iyP~~~~~F~~lC~DGsl~~v~Ld~~Gk~~~~~t~~ 177 (342)
T PF06433_consen 98 NMFALSADGKFLYVQNFTPATSVTVVDLAAKKVVGEIDTPGCWLIYPSGNRGFSMLCGDGSLLTVTLDADGKEAQKSTKV 177 (342)
T ss_dssp GGEEE-TTSSEEEEEEESSSEEEEEEETTTTEEEEEEEGTSEEEEEEEETTEEEEEETTSCEEEEEETSTSSEEEEEEEE
T ss_pred cceEEccCCcEEEEEccCCCCeEEEEECCCCceeeeecCCCEEEEEecCCCceEEEecCCceEEEEECCCCCEeEeeccc
Confidence 66789999999988765 112222234 23467788899999888887 45443221
Q ss_pred -ecCCCCe-EEEEEecCCCEEEEecCCCeEEEEEcCCCee--eEee-------------cCCceeEEEcCCC--cEEE-E
Q 040274 106 -LYHQGPV-SALAFHPNGHLMATTGKECKIKIWDLRKYEV--LQTL-------------TGHAKTLDFSQKG--LLAV-G 165 (359)
Q Consensus 106 -~~h~~~v-~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~--~~~~-------------~~~v~~~~~s~~g--l~~~-~ 165 (359)
..-..++ ..-.+...+..++..+-+|.|+--|+..... ...+ ++.-.-+++++.. |+.. -
T Consensus 178 F~~~~dp~f~~~~~~~~~~~~~F~Sy~G~v~~~dlsg~~~~~~~~~~~~t~~e~~~~WrPGG~Q~~A~~~~~~rlyvLMh 257 (342)
T PF06433_consen 178 FDPDDDPLFEHPAYSRDGGRLYFVSYEGNVYSADLSGDSAKFGKPWSLLTDAEKADGWRPGGWQLIAYHAASGRLYVLMH 257 (342)
T ss_dssp SSTTTS-B-S--EEETTTTEEEEEBTTSEEEEEEETTSSEEEEEEEESS-HHHHHTTEEE-SSS-EEEETTTTEEEEEEE
T ss_pred cCCCCcccccccceECCCCeEEEEecCCEEEEEeccCCcccccCcccccCccccccCcCCcceeeeeeccccCeEEEEec
Confidence 1222222 3444555555666678899999988876442 2222 1223446666543 2221 1
Q ss_pred --cC-------CcEEEEcCCCCCccccccc-cccCCCCcceeEEEEccCCC-EEEEE-eCCCeEEEEEcCCCC
Q 040274 166 --TG-------SFAQILGDFSGSHNYSRYM-GNSMVKGYQIGKVSFRPYED-VLGIG-HSMGWSGILVPRSSE 226 (359)
Q Consensus 166 --~d-------~~i~v~d~~~~~~~~~~~~-~~~~~~~~~v~~~~~sp~~~-~l~~g-~~dg~~~i~~~gs~~ 226 (359)
.+ ..|.+||+.+. +.+..+. .+ .+.++..+.+.. .|++. ..++.+.++...++.
T Consensus 258 ~g~~gsHKdpgteVWv~D~~t~-krv~Ri~l~~------~~~Si~Vsqd~~P~L~~~~~~~~~l~v~D~~tGk 323 (342)
T PF06433_consen 258 QGGEGSHKDPGTEVWVYDLKTH-KRVARIPLEH------PIDSIAVSQDDKPLLYALSAGDGTLDVYDAATGK 323 (342)
T ss_dssp E--TT-TTS-EEEEEEEETTTT-EEEEEEEEEE------EESEEEEESSSS-EEEEEETTTTEEEEEETTT--
T ss_pred CCCCCCccCCceEEEEEECCCC-eEEEEEeCCC------ccceEEEccCCCcEEEEEcCCCCeEEEEeCcCCc
Confidence 11 15777786554 4444443 33 688999998775 44433 346777777776653
No 401
>COG5167 VID27 Protein involved in vacuole import and degradation [Intracellular trafficking and secretion]
Probab=94.93 E-value=0.97 Score=42.80 Aligned_cols=134 Identities=7% Similarity=-0.014 Sum_probs=84.7
Q ss_pred CCCEEEE-EeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCC--------CEEEEecCCCeEEEEEcCC-CeeeE--
Q 040274 78 FNGVVSL-GHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNG--------HLMATTGKECKIKIWDLRK-YEVLQ-- 145 (359)
Q Consensus 78 ~~~~l~t-g~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g--------~~l~s~~~d~~i~vwd~~~-~~~~~-- 145 (359)
+..+|++ |.....++-.|+..|+.+-.+..|... -+.|+|+. ..|+ |-.+..|.-.|.|. |..+.
T Consensus 478 dssli~~dg~~~~kLykmDIErGkvveeW~~~ddv--vVqy~p~~kf~qmt~eqtlv-GlS~~svFrIDPR~~gNKi~v~ 554 (776)
T COG5167 478 DSSLIYLDGGERDKLYKMDIERGKVVEEWDLKDDV--VVQYNPYFKFQQMTDEQTLV-GLSDYSVFRIDPRARGNKIKVV 554 (776)
T ss_pred CcceEEecCCCcccceeeecccceeeeEeecCCcc--eeecCCchhHHhcCccceEE-eecccceEEecccccCCceeee
Confidence 4444443 444556777788888888888776664 56777742 2333 44455566667664 32222
Q ss_pred eecCC-----ceeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 146 TLTGH-----AKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 146 ~~~~~-----v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
..... -+|..-..+| ++++|..|.|++|| +-+......+++.. ..|-.+..+.+|++|++.|..-.+-+
T Consensus 555 esKdY~tKn~Fss~~tTesGyIa~as~kGDirLyD-Rig~rAKtalP~lG----~aIk~idvta~Gk~ilaTCk~yllL~ 629 (776)
T COG5167 555 ESKDYKTKNKFSSGMTTESGYIAAASRKGDIRLYD-RIGKRAKTALPGLG----DAIKHIDVTANGKHILATCKNYLLLT 629 (776)
T ss_pred eehhccccccccccccccCceEEEecCCCceeeeh-hhcchhhhcCcccc----cceeeeEeecCCcEEEEeecceEEEE
Confidence 22222 3445555677 77788889999999 55544444555543 37999999999999988887765444
No 402
>PHA02713 hypothetical protein; Provisional
Probab=94.92 E-value=0.34 Score=47.78 Aligned_cols=131 Identities=7% Similarity=0.047 Sum_probs=64.0
Q ss_pred CCCEEEEEeCCC-----eEEEEeCCCCcceE--EeecCCCCeEEEEEecCCCEEEEecCCC-------------------
Q 040274 78 FNGVVSLGHSGG-----TVTMWKPTTSALLI--KMLYHQGPVSALAFHPNGHLMATTGKEC------------------- 131 (359)
Q Consensus 78 ~~~~l~tg~~dg-----~v~lwd~~~~~~~~--~~~~h~~~v~~l~~~p~g~~l~s~~~d~------------------- 131 (359)
+|.+.+.|+.++ +|..||+.+.+... .+.........++ -+|.+.+.||.++
T Consensus 351 ~g~IYviGG~~~~~~~~sve~Ydp~~~~W~~~~~mp~~r~~~~~~~--~~g~IYviGG~~~~~~~~~~~~~~~~~~~~~~ 428 (557)
T PHA02713 351 DDTIYAIGGQNGTNVERTIECYTMGDDKWKMLPDMPIALSSYGMCV--LDQYIYIIGGRTEHIDYTSVHHMNSIDMEEDT 428 (557)
T ss_pred CCEEEEECCcCCCCCCceEEEEECCCCeEEECCCCCcccccccEEE--ECCEEEEEeCCCcccccccccccccccccccc
Confidence 345566676653 48889988664322 1211111111222 3677777777652
Q ss_pred ----eEEEEEcCCCee--eEeec-CCc-eeEEEcCCC-cEEEEcC------CcEEEEcCCC-CCcc-ccccccccCCCCc
Q 040274 132 ----KIKIWDLRKYEV--LQTLT-GHA-KTLDFSQKG-LLAVGTG------SFAQILGDFS-GSHN-YSRYMGNSMVKGY 194 (359)
Q Consensus 132 ----~i~vwd~~~~~~--~~~~~-~~v-~~~~~s~~g-l~~~~~d------~~i~v~d~~~-~~~~-~~~~~~~~~~~~~ 194 (359)
.+..||..+.+- +..+. ... .+++...+. ++.||.+ ..+..||+.+ .... ...+.....
T Consensus 429 ~~~~~ve~YDP~td~W~~v~~m~~~r~~~~~~~~~~~IYv~GG~~~~~~~~~~ve~Ydp~~~~~W~~~~~m~~~r~---- 504 (557)
T PHA02713 429 HSSNKVIRYDTVNNIWETLPNFWTGTIRPGVVSHKDDIYVVCDIKDEKNVKTCIFRYNTNTYNGWELITTTESRLS---- 504 (557)
T ss_pred cccceEEEECCCCCeEeecCCCCcccccCcEEEECCEEEEEeCCCCCCccceeEEEecCCCCCCeeEccccCcccc----
Confidence 477788876543 22221 111 122222222 5555543 2467899765 3222 222222211
Q ss_pred ceeEEEEccCCCEEEEEeCCCe
Q 040274 195 QIGKVSFRPYEDVLGIGHSMGW 216 (359)
Q Consensus 195 ~v~~~~~sp~~~~l~~g~~dg~ 216 (359)
....+. -+|.+.++|+.+|.
T Consensus 505 ~~~~~~--~~~~iyv~Gg~~~~ 524 (557)
T PHA02713 505 ALHTIL--HDNTIMMLHCYESY 524 (557)
T ss_pred cceeEE--ECCEEEEEeeecce
Confidence 122222 27788888888873
No 403
>PF10313 DUF2415: Uncharacterised protein domain (DUF2415); InterPro: IPR019417 This entry represents a short (30 residues) domain of unknown function found in a family of fungal proteins. It contains a characteristic DLL sequence motif.
Probab=94.84 E-value=0.11 Score=31.44 Aligned_cols=31 Identities=29% Similarity=0.461 Sum_probs=24.4
Q ss_pred CCeEEEEEecCCC---EEEEecCCCeEEEEEcCC
Q 040274 110 GPVSALAFHPNGH---LMATTGKECKIKIWDLRK 140 (359)
Q Consensus 110 ~~v~~l~~~p~g~---~l~s~~~d~~i~vwd~~~ 140 (359)
+.|.++.|+|++. +|+.+-.-+.|.|+|+++
T Consensus 1 GAvR~~kFsP~~~~~DLL~~~E~~g~vhi~D~R~ 34 (43)
T PF10313_consen 1 GAVRCCKFSPEPGGNDLLAWAEHQGRVHIVDTRS 34 (43)
T ss_pred CCeEEEEeCCCCCcccEEEEEccCCeEEEEEccc
Confidence 4678889997544 788887788899999884
No 404
>KOG2444 consensus WD40 repeat protein [General function prediction only]
Probab=94.83 E-value=0.14 Score=43.24 Aligned_cols=93 Identities=15% Similarity=0.220 Sum_probs=54.9
Q ss_pred CCCEEEEEeCCCeEEEEeCCCCcceEEee--cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecCCceeEE
Q 040274 78 FNGVVSLGHSGGTVTMWKPTTSALLIKML--YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTGHAKTLD 155 (359)
Q Consensus 78 ~~~~l~tg~~dg~v~lwd~~~~~~~~~~~--~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~~v~~~~ 155 (359)
.+..+++|+.+|.|.+|.++-........ +-......+.--.++.+..+++.||.|+.|++..++.+-.... ..
T Consensus 69 ~~~~~~vG~~dg~v~~~n~n~~g~~~d~~~s~~e~i~~~Ip~~~~~~~~c~~~~dg~ir~~n~~p~k~~g~~g~----h~ 144 (238)
T KOG2444|consen 69 ASAKLMVGTSDGAVYVFNWNLEGAHSDRVCSGEESIDLGIPNGRDSSLGCVGAQDGRIRACNIKPNKVLGYVGQ----HN 144 (238)
T ss_pred cCceEEeecccceEEEecCCccchHHHhhhcccccceeccccccccceeEEeccCCceeeeccccCceeeeecc----cc
Confidence 45678899999999999987322111111 1122222232233566888999999999999887665433321 11
Q ss_pred EcCCC-cEEEEcCCcEEEEc
Q 040274 156 FSQKG-LLAVGTGSFAQILG 174 (359)
Q Consensus 156 ~s~~g-l~~~~~d~~i~v~d 174 (359)
+.|.. +++.+.+..|.+|+
T Consensus 145 ~~~~e~~ivv~sd~~i~~a~ 164 (238)
T KOG2444|consen 145 FESGEELIVVGSDEFLKIAD 164 (238)
T ss_pred CCCcceeEEecCCceEEeec
Confidence 22222 55566666666665
No 405
>PF10168 Nup88: Nuclear pore component; InterPro: IPR019321 Nup88 can be divided into two structural domains; the N-terminal two-thirds of the protein have no obvious structural motifs. It is, however, where it binds to Nup98; one of the components of the nuclear pore. The C-terminal end is a predicted coiled-coil domain []. Nup88 is over expressed in tumour cells [].
Probab=94.80 E-value=1.7 Score=43.94 Aligned_cols=48 Identities=17% Similarity=0.304 Sum_probs=41.7
Q ss_pred eEEEECCCCCEEEEecc-------------------------------------------ceeEEEEcCC---CCEEEEE
Q 040274 52 ILWILPSSGRYMAVAGR-------------------------------------------RTDLMRVNPF---NGVVSLG 85 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-------------------------------------------~v~~l~~sp~---~~~l~tg 85 (359)
..+.++|+|++|+..|. .|..+.|||. +..|+.-
T Consensus 88 ~~i~~n~~g~~lal~G~~~v~V~~LP~r~g~~~~~~~g~~~i~Crt~~v~~~~~~~~~~~~i~qv~WhP~s~~~~~l~vL 167 (717)
T PF10168_consen 88 HQISLNPTGSLLALVGPRGVVVLELPRRWGKNGEFEDGKKEINCRTVPVDERFFTSNSSLEIKQVRWHPWSESDSHLVVL 167 (717)
T ss_pred EEEEECCCCCEEEEEcCCcEEEEEeccccCccccccCCCcceeEEEEEechhhccCCCCceEEEEEEcCCCCCCCeEEEE
Confidence 78889999999998776 7889999996 4788888
Q ss_pred eCCCeEEEEeCCCC
Q 040274 86 HSGGTVTMWKPTTS 99 (359)
Q Consensus 86 ~~dg~v~lwd~~~~ 99 (359)
..|+++++||+...
T Consensus 168 tsdn~lR~y~~~~~ 181 (717)
T PF10168_consen 168 TSDNTLRLYDISDP 181 (717)
T ss_pred ecCCEEEEEecCCC
Confidence 99999999998754
No 406
>cd00216 PQQ_DH Dehydrogenases with pyrrolo-quinoline quinone (PQQ) as cofactor, like ethanol, methanol, and membrane bound glucose dehydrogenases. The alignment model contains an 8-bladed beta-propeller.
Probab=94.74 E-value=1.1 Score=43.52 Aligned_cols=68 Identities=10% Similarity=0.062 Sum_probs=49.1
Q ss_pred CCEEEEEeCCCeEEEEeCCCCcceEEeecCCC------CeE--EEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee
Q 040274 79 NGVVSLGHSGGTVTMWKPTTSALLIKMLYHQG------PVS--ALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL 147 (359)
Q Consensus 79 ~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~------~v~--~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~ 147 (359)
+..+++++.++.|.-.|..+++.+..+..... .+. .+++. ++..++.++.++.|+.+|..+|+.+..+
T Consensus 61 ~g~vy~~~~~g~l~AlD~~tG~~~W~~~~~~~~~~~~~~~~~~g~~~~-~~~~V~v~~~~g~v~AlD~~TG~~~W~~ 136 (488)
T cd00216 61 DGDMYFTTSHSALFALDAATGKVLWRYDPKLPADRGCCDVVNRGVAYW-DPRKVFFGTFDGRLVALDAETGKQVWKF 136 (488)
T ss_pred CCEEEEeCCCCcEEEEECCCChhhceeCCCCCccccccccccCCcEEc-cCCeEEEecCCCeEEEEECCCCCEeeee
Confidence 45677788889999999999988877654322 110 11111 2257778888999999999999988777
No 407
>KOG4441 consensus Proteins containing BTB/POZ and Kelch domains, involved in regulatory/signal transduction processes [Signal transduction mechanisms; General function prediction only]
Probab=94.67 E-value=0.62 Score=46.02 Aligned_cols=150 Identities=13% Similarity=0.129 Sum_probs=77.3
Q ss_pred CCCEEEEEeCCC-----eEEEEeCCCCcceEEeecCCCCeEEEEE-ecCCCEEEEecCCC------eEEEEEcCCCeee-
Q 040274 78 FNGVVSLGHSGG-----TVTMWKPTTSALLIKMLYHQGPVSALAF-HPNGHLMATTGKEC------KIKIWDLRKYEVL- 144 (359)
Q Consensus 78 ~~~~l~tg~~dg-----~v~lwd~~~~~~~~~~~~h~~~v~~l~~-~p~g~~l~s~~~d~------~i~vwd~~~~~~~- 144 (359)
+|.+.++|+.|| +|..||+.+.+.-..-.... ...+.+. .-+|.+.++||.|+ ++..||..+....
T Consensus 380 ~g~iYavGG~dg~~~l~svE~YDp~~~~W~~va~m~~-~r~~~gv~~~~g~iYi~GG~~~~~~~l~sve~YDP~t~~W~~ 458 (571)
T KOG4441|consen 380 DGKLYAVGGFDGEKSLNSVECYDPVTNKWTPVAPMLT-RRSGHGVAVLGGKLYIIGGGDGSSNCLNSVECYDPETNTWTL 458 (571)
T ss_pred CCEEEEEeccccccccccEEEecCCCCcccccCCCCc-ceeeeEEEEECCEEEEEcCcCCCccccceEEEEcCCCCceee
Confidence 466778888886 48889988765332221111 2222222 23677888888664 4778888775432
Q ss_pred -EeecC--CceeEEEcCCC-cEEEEcCC-----cEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 145 -QTLTG--HAKTLDFSQKG-LLAVGTGS-----FAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 145 -~~~~~--~v~~~~~s~~g-l~~~~~d~-----~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
..+.. .-..++.-.+- ++.+|.++ +|..||..+........+... ...+..+ .-++...++|+.+|
T Consensus 459 ~~~M~~~R~~~g~a~~~~~iYvvGG~~~~~~~~~VE~ydp~~~~W~~v~~m~~~---rs~~g~~--~~~~~ly~vGG~~~ 533 (571)
T KOG4441|consen 459 IAPMNTRRSGFGVAVLNGKIYVVGGFDGTSALSSVERYDPETNQWTMVAPMTSP---RSAVGVV--VLGGKLYAVGGFDG 533 (571)
T ss_pred cCCcccccccceEEEECCEEEEECCccCCCccceEEEEcCCCCceeEcccCccc---cccccEE--EECCEEEEEecccC
Confidence 22211 11223333333 55666554 478898765533332222221 1112122 22667778888887
Q ss_pred eEEEEEcCCCCCceeeec
Q 040274 216 WSGILVPRSSEPNFDSWV 233 (359)
Q Consensus 216 ~~~i~~~gs~~~~~~~~~ 233 (359)
...+=..-.-|+..+.|.
T Consensus 534 ~~~l~~ve~ydp~~d~W~ 551 (571)
T KOG4441|consen 534 NNNLNTVECYDPETDTWT 551 (571)
T ss_pred ccccceeEEcCCCCCcee
Confidence 543322222345555554
No 408
>TIGR02604 Piru_Ver_Nterm putative membrane-bound dehydrogenase domain. All proteins that score above the trusted cutoff score of 45 to this model are large proteins of either Pirellula sp. 1 or Verrucomicrobium spinosum. These proteins all contain, in addition to this domain, several hundred residues of highly variable sequence, and then a well-conserved C-terminal domain (TIGR02603) that features a putative cytochrome c-type heme binding motif CXXCH. The membrane-bound L-sorbosone dehydrogenase from Acetobacter liquefaciens (Gluconacetobacter liquefaciens) is homologous to this domain but lacks additional sequence regions shared by members of this family and belongs to a different clade of the larger family of homologs. It and its closely related homologs are excluded from the this model by scoring between the trusted (45) and noise (18) cutoffs.
Probab=94.60 E-value=0.83 Score=42.51 Aligned_cols=95 Identities=13% Similarity=0.162 Sum_probs=52.7
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCC-----c--ceEE-eec----CCCCeEEEEEecCCCEEEEecCC------
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTS-----A--LLIK-MLY----HQGPVSALAFHPNGHLMATTGKE------ 130 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~-----~--~~~~-~~~----h~~~v~~l~~~p~g~~l~s~~~d------ 130 (359)
..+.|++.+++ +++ ++.+...++.|.... + .+.. +.. +....+.+.|.|||.+.++.+..
T Consensus 73 ~p~Gi~~~~~G-lyV-~~~~~i~~~~d~~gdg~ad~~~~~l~~~~~~~~~~~~~~~~~l~~gpDG~LYv~~G~~~~~~~~ 150 (367)
T TIGR02604 73 MVTGLAVAVGG-VYV-ATPPDILFLRDKDGDDKADGEREVLLSGFGGQINNHHHSLNSLAWGPDGWLYFNHGNTLASKVT 150 (367)
T ss_pred CccceeEecCC-EEE-eCCCeEEEEeCCCCCCCCCCccEEEEEccCCCCCcccccccCceECCCCCEEEecccCCCceec
Confidence 45778888877 444 444433334454321 1 1211 222 13447789999999887765521
Q ss_pred -------------CeEEEEEcCCCeeeEee-cC--CceeEEEcCCC-cEEEEc
Q 040274 131 -------------CKIKIWDLRKYEVLQTL-TG--HAKTLDFSQKG-LLAVGT 166 (359)
Q Consensus 131 -------------~~i~vwd~~~~~~~~~~-~~--~v~~~~~s~~g-l~~~~~ 166 (359)
+.|..+|...+.. ..+ .+ ....++|+|+| ++++..
T Consensus 151 ~~~~~~~~~~~~~g~i~r~~pdg~~~-e~~a~G~rnp~Gl~~d~~G~l~~tdn 202 (367)
T TIGR02604 151 RPGTSDESRQGLGGGLFRYNPDGGKL-RVVAHGFQNPYGHSVDSWGDVFFCDN 202 (367)
T ss_pred cCCCccCcccccCceEEEEecCCCeE-EEEecCcCCCccceECCCCCEEEEcc
Confidence 4456666654432 222 22 24789999999 555443
No 409
>KOG4460 consensus Nuclear pore complex, Nup88/rNup84 component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=94.59 E-value=0.57 Score=44.38 Aligned_cols=91 Identities=12% Similarity=0.049 Sum_probs=56.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
.|..+..|+.|..++..+.+|.+.++=++...+-..+......|+|-.+.-+. .|++.+. .+
T Consensus 105 eV~~vl~s~~GS~VaL~G~~Gi~vMeLp~rwG~~s~~eDgk~~v~CRt~~i~~-~~ftss~--~l--------------- 166 (741)
T KOG4460|consen 105 EVYQVLLSPTGSHVALIGIKGLMVMELPKRWGKNSEFEDGKSTVNCRTTPVAE-RFFTSST--SL--------------- 166 (741)
T ss_pred EEEEEEecCCCceEEEecCCeeEEEEchhhcCccceecCCCceEEEEeecccc-eeeccCC--ce---------------
Confidence 68888889999999999899988777655444444444434445554443322 2222211 01
Q ss_pred CCceeEEEcCCC-----cEEEEcCCcEEEEcCCCC
Q 040274 149 GHAKTLDFSQKG-----LLAVGTGSFAQILGDFSG 178 (359)
Q Consensus 149 ~~v~~~~~s~~g-----l~~~~~d~~i~v~d~~~~ 178 (359)
.+...+|+|+. ++.-+.|+.|++||....
T Consensus 167 -tl~Qa~WHP~S~~D~hL~iL~sdnviRiy~lS~~ 200 (741)
T KOG4460|consen 167 -TLKQAAWHPSSILDPHLVLLTSDNVIRIYSLSEP 200 (741)
T ss_pred -eeeeccccCCccCCceEEEEecCcEEEEEecCCc
Confidence 13456777765 677788889999986443
No 410
>PF10214 Rrn6: RNA polymerase I-specific transcription-initiation factor; InterPro: IPR019350 RNA polymerase I-specific transcription-initiation factor Rrn6 and Rrn7 represent components of a multisubunit transcription factor essential for the initiation of rDNA transcription by Pol I []. These proteins are found in fungi.
Probab=94.48 E-value=2.4 Score=43.61 Aligned_cols=108 Identities=11% Similarity=0.100 Sum_probs=68.6
Q ss_pred ceeEEEEcC-CCCEEEEEeCCCeEEEEeCCCC----cceEEee-cCCCCe----------EEEEEecCCCEEEEecCCCe
Q 040274 69 RTDLMRVNP-FNGVVSLGHSGGTVTMWKPTTS----ALLIKML-YHQGPV----------SALAFHPNGHLMATTGKECK 132 (359)
Q Consensus 69 ~v~~l~~sp-~~~~l~tg~~dg~v~lwd~~~~----~~~~~~~-~h~~~v----------~~l~~~p~g~~l~s~~~d~~ 132 (359)
+...++|+| +...||+....|...||++... .....+. .+.+.+ ..+.|.++.+.|+.++. ..
T Consensus 147 ~~aDv~FnP~~~~q~AiVD~~G~Wsvw~i~~~~~~~~~~~~~~~~~~gsi~~d~~e~s~w~rI~W~~~~~~lLv~~r-~~ 225 (765)
T PF10214_consen 147 PHADVAFNPWDQRQFAIVDEKGNWSVWDIKGRPKRKSSNLRLSRNISGSIIFDPEELSNWKRILWVSDSNRLLVCNR-SK 225 (765)
T ss_pred ccceEEeccCccceEEEEeccCcEEEEEeccccccCCcceeeccCCCccccCCCcccCcceeeEecCCCCEEEEEcC-Cc
Confidence 788999999 5678999999999999999211 1111111 122222 36778887777777655 45
Q ss_pred EEEEEcCCCeeeEee-----cCCceeEEEcCCC--cEEEEcCCcEEEEcCCC
Q 040274 133 IKIWDLRKYEVLQTL-----TGHAKTLDFSQKG--LLAVGTGSFAQILGDFS 177 (359)
Q Consensus 133 i~vwd~~~~~~~~~~-----~~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~ 177 (359)
+.++|+.+......+ ...|.++.-+|.. .+..-+...|..+++..
T Consensus 226 l~~~d~~~~~~~~~l~~~~~~~~IlDv~~~~~~~~~~FiLTs~eiiw~~~~~ 277 (765)
T PF10214_consen 226 LMLIDFESNWQTEYLVTAKTWSWILDVKRSPDNPSHVFILTSKEIIWLDVKS 277 (765)
T ss_pred eEEEECCCCCccchhccCCChhheeeEEecCCccceEEEEecCeEEEEEccC
Confidence 888899876542212 2457788888873 22222335677777554
No 411
>PRK13684 Ycf48-like protein; Provisional
Probab=94.42 E-value=1.5 Score=40.24 Aligned_cols=120 Identities=17% Similarity=0.177 Sum_probs=72.8
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeec-
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLY- 107 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~- 107 (359)
+++.+.|+|.+++++.. .++++.+.+++..+++| ..|.+.+=+.+.+..=.....
T Consensus 176 ~~i~~~~~g~~v~~g~~G~i~~s~~~gg~tW~~~~~~~~~~l~~i~~~~~g~~~~vg-~~G~~~~~s~d~G~sW~~~~~~ 254 (334)
T PRK13684 176 RNLRRSPDGKYVAVSSRGNFYSTWEPGQTAWTPHQRNSSRRLQSMGFQPDGNLWMLA-RGGQIRFNDPDDLESWSKPIIP 254 (334)
T ss_pred EEEEECCCCeEEEEeCCceEEEEcCCCCCeEEEeeCCCcccceeeeEcCCCCEEEEe-cCCEEEEccCCCCCccccccCC
Confidence 78888898888876543 56778888888777665 456664323343321111111
Q ss_pred ---CCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee------cCCceeEEEcCCC-cEEEEcCCcEEEEc
Q 040274 108 ---HQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL------TGHAKTLDFSQKG-LLAVGTGSFAQILG 174 (359)
Q Consensus 108 ---h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~------~~~v~~~~~s~~g-l~~~~~d~~i~v~d 174 (359)
....+.++.+.|++..++ ++.+|.|.. -...++.-... +...+.+.|..++ .++++..|.|.-|+
T Consensus 255 ~~~~~~~l~~v~~~~~~~~~~-~G~~G~v~~-S~d~G~tW~~~~~~~~~~~~~~~~~~~~~~~~~~~G~~G~il~~~ 329 (334)
T PRK13684 255 EITNGYGYLDLAYRTPGEIWA-GGGNGTLLV-SKDGGKTWEKDPVGEEVPSNFYKIVFLDPEKGFVLGQRGVLLRYV 329 (334)
T ss_pred ccccccceeeEEEcCCCCEEE-EcCCCeEEE-eCCCCCCCeECCcCCCCCcceEEEEEeCCCceEEECCCceEEEec
Confidence 123478889998877554 556676553 33433332222 2235667776666 77888888888776
No 412
>PF07569 Hira: TUP1-like enhancer of split; InterPro: IPR011494 The Hira proteins are found in a range of eukaryotes and are implicated in the assembly of repressive chromatin. These proteins also contain IPR001680 from INTERPRO.; GO: 0006355 regulation of transcription, DNA-dependent, 0005634 nucleus
Probab=94.34 E-value=0.3 Score=41.80 Aligned_cols=28 Identities=11% Similarity=0.154 Sum_probs=23.3
Q ss_pred EcCCCCEEEEEeCCCeEEEEeCCCCcce
Q 040274 75 VNPFNGVVSLGHSGGTVTMWKPTTSALL 102 (359)
Q Consensus 75 ~sp~~~~l~tg~~dg~v~lwd~~~~~~~ 102 (359)
+...+.++++...+|.+++||+.+++.+
T Consensus 18 l~~~~~~Ll~iT~~G~l~vWnl~~~k~~ 45 (219)
T PF07569_consen 18 LECNGSYLLAITSSGLLYVWNLKKGKAV 45 (219)
T ss_pred EEeCCCEEEEEeCCCeEEEEECCCCeec
Confidence 4556888999999999999999987653
No 413
>PF14727 PHTB1_N: PTHB1 N-terminus
Probab=94.30 E-value=3 Score=39.35 Aligned_cols=136 Identities=10% Similarity=0.065 Sum_probs=77.6
Q ss_pred CCCEEEEEeCCCeEEEEeCCCCcce--EEe-e-cCCCCeEEEEEec----CCCEEEEecCCCeEEEEEcCC--Ce-----
Q 040274 78 FNGVVSLGHSGGTVTMWKPTTSALL--IKM-L-YHQGPVSALAFHP----NGHLMATTGKECKIKIWDLRK--YE----- 142 (359)
Q Consensus 78 ~~~~l~tg~~dg~v~lwd~~~~~~~--~~~-~-~h~~~v~~l~~~p----~g~~l~s~~~d~~i~vwd~~~--~~----- 142 (359)
+...|++||..|.++||++...... ..+ . --..+|..+.+.. .....++.-.-..+.||.+.. |.
T Consensus 36 ~~d~IivGS~~G~LrIy~P~~~~~~~~~lllE~~l~~PILqv~~G~F~s~~~~~~LaVLhP~kl~vY~v~~~~g~~~~g~ 115 (418)
T PF14727_consen 36 GSDKIIVGSYSGILRIYDPSGNEFQPEDLLLETQLKDPILQVECGKFVSGSEDLQLAVLHPRKLSVYSVSLVDGTVEHGN 115 (418)
T ss_pred CccEEEEeccccEEEEEccCCCCCCCccEEEEEecCCcEEEEEeccccCCCCcceEEEecCCEEEEEEEEecCCCcccCc
Confidence 3458999999999999999654311 111 1 2246777776532 122222224456677777631 11
Q ss_pred -----eeEe--ecCCceeEEEcCCC-------cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEE
Q 040274 143 -----VLQT--LTGHAKTLDFSQKG-------LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVL 208 (359)
Q Consensus 143 -----~~~~--~~~~v~~~~~s~~g-------l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l 208 (359)
.+.. +.....++++-|=| +..-+.||.+.+|+ ...-.....++.. . -...+.|+|.-+.+
T Consensus 116 ~~~L~~~yeh~l~~~a~nm~~G~Fgg~~~~~~IcVQS~DG~L~~fe-qe~~~f~~~lp~~-l----lPgPl~Y~~~tDsf 189 (418)
T PF14727_consen 116 QYQLELIYEHSLQRTAYNMCCGPFGGVKGRDFICVQSMDGSLSFFE-QESFAFSRFLPDF-L----LPGPLCYCPRTDSF 189 (418)
T ss_pred EEEEEEEEEEecccceeEEEEEECCCCCCceEEEEEecCceEEEEe-CCcEEEEEEcCCC-C----CCcCeEEeecCCEE
Confidence 1111 13334555555433 56677899999998 3331112222222 2 23447888888889
Q ss_pred EEEeCCCeEEE
Q 040274 209 GIGHSMGWSGI 219 (359)
Q Consensus 209 ~~g~~dg~~~i 219 (359)
++++.+..+..
T Consensus 190 vt~sss~~l~~ 200 (418)
T PF14727_consen 190 VTASSSWTLEC 200 (418)
T ss_pred EEecCceeEEE
Confidence 98888876654
No 414
>PF05694 SBP56: 56kDa selenium binding protein (SBP56); InterPro: IPR008826 This family consists of several eukaryotic selenium binding proteins as well as three sequences from archaea. The exact function of this protein is unknown although it is thought that SBP56 participates in late stages of intra-Golgi protein transport []. The Lotus japonicus homologue of SBP56, LjSBP is thought to have more than one physiological role and can be implicated in controlling the oxidation/reduction status of target proteins in vesicular Golgi transport [].; GO: 0008430 selenium binding; PDB: 2ECE_A.
Probab=94.28 E-value=0.4 Score=44.69 Aligned_cols=92 Identities=12% Similarity=0.075 Sum_probs=49.7
Q ss_pred CCeEEEEeCCCCcceEEeecCC--CCeEEEEE--ecCCCE-EEEecCCCeEEEEEc-CCCe----eeEee----------
Q 040274 88 GGTVTMWKPTTSALLIKMLYHQ--GPVSALAF--HPNGHL-MATTGKECKIKIWDL-RKYE----VLQTL---------- 147 (359)
Q Consensus 88 dg~v~lwd~~~~~~~~~~~~h~--~~v~~l~~--~p~g~~-l~s~~~d~~i~vwd~-~~~~----~~~~~---------- 147 (359)
..++.+||+.+.+.++++.-.. .....+.| +|+..+ |+.+....+|..|-- ..+. .+..+
T Consensus 221 G~~l~vWD~~~r~~~Q~idLg~~g~~pLEvRflH~P~~~~gFvg~aLss~i~~~~k~~~g~W~a~kVi~ip~~~v~~~~l 300 (461)
T PF05694_consen 221 GHSLHVWDWSTRKLLQTIDLGEEGQMPLEVRFLHDPDANYGFVGCALSSSIWRFYKDDDGEWAAEKVIDIPAKKVEGWIL 300 (461)
T ss_dssp --EEEEEETTTTEEEEEEES-TTEEEEEEEEE-SSTT--EEEEEEE--EEEEEEEE-ETTEEEEEEEEEE--EE--SS--
T ss_pred cCeEEEEECCCCcEeeEEecCCCCCceEEEEecCCCCccceEEEEeccceEEEEEEcCCCCeeeeEEEECCCcccCcccc
Confidence 4579999999999998887432 23456666 444444 444555666766643 2222 12222
Q ss_pred ----------cCCceeEEEcCCC--cEEEE-cCCcEEEEcCCCCC
Q 040274 148 ----------TGHAKTLDFSQKG--LLAVG-TGSFAQILGDFSGS 179 (359)
Q Consensus 148 ----------~~~v~~~~~s~~g--l~~~~-~d~~i~v~d~~~~~ 179 (359)
++-+++|.+|.|. |+.++ ..|.|+.||+....
T Consensus 301 p~ml~~~~~~P~LitDI~iSlDDrfLYvs~W~~GdvrqYDISDP~ 345 (461)
T PF05694_consen 301 PEMLKPFGAVPPLITDILISLDDRFLYVSNWLHGDVRQYDISDPF 345 (461)
T ss_dssp -GGGGGG-EE------EEE-TTS-EEEEEETTTTEEEEEE-SSTT
T ss_pred cccccccccCCCceEeEEEccCCCEEEEEcccCCcEEEEecCCCC
Confidence 1236899999998 33333 47999999976653
No 415
>PF13449 Phytase-like: Esterase-like activity of phytase
Probab=94.04 E-value=4.6 Score=36.87 Aligned_cols=142 Identities=15% Similarity=0.152 Sum_probs=81.3
Q ss_pred ceeEEEEcCCCCEEEEEeCCCe------EEEEeCCC--C--cce-----EEeecCCC--------CeEEEEEecCCCEEE
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGT------VTMWKPTT--S--ALL-----IKMLYHQG--------PVSALAFHPNGHLMA 125 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~------v~lwd~~~--~--~~~-----~~~~~h~~--------~v~~l~~~p~g~~l~ 125 (359)
.++.|.+.|++..+++.+.+|. +..+++.. + ..+ ..+....+ ..-+|++.++|.+++
T Consensus 21 GlSgl~~~~~~~~~~avSD~g~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~L~~~~G~~~~~~~~D~Egi~~~~~g~~~i 100 (326)
T PF13449_consen 21 GLSGLDYDPDDGRFYAVSDRGPNKGPPRFYTFRIDYDQGGIGGVTILDMIPLRDPDGQPFPKNGLDPEGIAVPPDGSFWI 100 (326)
T ss_pred cEeeEEEeCCCCEEEEEECCCCCCCCCcEEEEEeeccCCCccceEeccceeccCCCCCcCCcCCCChhHeEEecCCCEEE
Confidence 4778888876666777777777 55555443 1 111 11111122 233788878898888
Q ss_pred EecCC------CeEEEEEcCCCeeeEee--c----------------CCceeEEEcCCC--cEEEEc-----CC------
Q 040274 126 TTGKE------CKIKIWDLRKYEVLQTL--T----------------GHAKTLDFSQKG--LLAVGT-----GS------ 168 (359)
Q Consensus 126 s~~~d------~~i~vwd~~~~~~~~~~--~----------------~~v~~~~~s~~g--l~~~~~-----d~------ 168 (359)
+.-.+ ..|..+|.. |..+..+ + ...-+++++|+| ++++.. |+
T Consensus 101 s~E~~~~~~~~p~I~~~~~~-G~~~~~~~vP~~~~~~~~~~~~~~~N~G~E~la~~~dG~~l~~~~E~~l~~d~~~~~~~ 179 (326)
T PF13449_consen 101 SSEGGRTGGIPPRIRRFDLD-GRVIRRFPVPAAFLPDANGTSGRRNNRGFEGLAVSPDGRTLFAAMESPLKQDGPRANPD 179 (326)
T ss_pred EeCCccCCCCCCEEEEECCC-CcccceEccccccccccCccccccCCCCeEEEEECCCCCEEEEEECccccCCCcccccc
Confidence 87777 889999876 6554443 1 124689999998 555442 21
Q ss_pred -----cEEEEcCCCCCccccc--cccccC---CCCcceeEEEEccCCCEEEEE
Q 040274 169 -----FAQILGDFSGSHNYSR--YMGNSM---VKGYQIGKVSFRPYEDVLGIG 211 (359)
Q Consensus 169 -----~i~v~d~~~~~~~~~~--~~~~~~---~~~~~v~~~~~sp~~~~l~~g 211 (359)
.|..||.......... |..... .....|+.+.+.+++++|+.=
T Consensus 180 ~~~~~ri~~~d~~~~~~~~~~~~y~ld~~~~~~~~~~isd~~al~d~~lLvLE 232 (326)
T PF13449_consen 180 NGSPLRILRYDPKTPGEPVAEYAYPLDPPPTAPGDNGISDIAALPDGRLLVLE 232 (326)
T ss_pred cCceEEEEEecCCCCCccceEEEEeCCccccccCCCCceeEEEECCCcEEEEE
Confidence 2334554332222222 211100 023468999999999977653
No 416
>PF00780 CNH: CNH domain; InterPro: IPR001180 Based on sequence similarities a domain of homology has been identified in the following proteins []: Citron and Citron kinase. These two proteins interact with the GTP-bound forms of the small GTPases Rho and Rac but not with Cdc42. Myotonic dystrophy kinase-related Cdc42-binding kinase (MRCKalpha). This serine/threonine kinase interacts with the GTP-bound form of the small GTPase Cdc42 and to a lesser extent with that of Rac. NCK Interacting Kinase (NIK), a serine/threonine protein kinase. ROM-1 and ROM-2, from yeast. These proteins are GDP/GTP exchange proteins (GEPs) for the small GTP binding protein Rho1. This domain, called the citron homology domain, is often found after cysteine rich and pleckstrin homology (PH) domains at the C-terminal end of the proteins []. It acts as a regulatory domain and could be involved in macromolecular interactions [, ].; GO: 0005083 small GTPase regulator activity
Probab=93.98 E-value=4.1 Score=35.92 Aligned_cols=108 Identities=16% Similarity=0.148 Sum_probs=64.7
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEE--------------eecCCCCeEEEE--EecCCCEEEEecCCCe
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIK--------------MLYHQGPVSALA--FHPNGHLMATTGKECK 132 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~--------------~~~h~~~v~~l~--~~p~g~~l~s~~~d~~ 132 (359)
.|..|...|+-+.+++-+ |+.++++++.+-..... -......+...+ -...+...+++.....
T Consensus 37 ~I~ql~vl~~~~~llvLs-d~~l~~~~L~~l~~~~~~~~~~~~~~~~~~~~~~~~~~v~~f~~~~~~~~~~~L~va~kk~ 115 (275)
T PF00780_consen 37 SITQLSVLPELNLLLVLS-DGQLYVYDLDSLEPVSTSAPLAFPKSRSLPTKLPETKGVSFFAVNGGHEGSRRLCVAVKKK 115 (275)
T ss_pred eEEEEEEecccCEEEEEc-CCccEEEEchhhccccccccccccccccccccccccCCeeEEeeccccccceEEEEEECCE
Confidence 688888888766655554 59999999875443331 112233344444 1223444444445558
Q ss_pred EEEEEcCCC-----eeeEee--cCCceeEEEcCCCcEEEEcCCcEEEEcCCCC
Q 040274 133 IKIWDLRKY-----EVLQTL--TGHAKTLDFSQKGLLAVGTGSFAQILGDFSG 178 (359)
Q Consensus 133 i~vwd~~~~-----~~~~~~--~~~v~~~~~s~~gl~~~~~d~~i~v~d~~~~ 178 (359)
|.+|..... ..+..+ +..+.+++|.++.++ .+..+...+.|+.++
T Consensus 116 i~i~~~~~~~~~f~~~~ke~~lp~~~~~i~~~~~~i~-v~~~~~f~~idl~~~ 167 (275)
T PF00780_consen 116 ILIYEWNDPRNSFSKLLKEISLPDPPSSIAFLGNKIC-VGTSKGFYLIDLNTG 167 (275)
T ss_pred EEEEEEECCcccccceeEEEEcCCCcEEEEEeCCEEE-EEeCCceEEEecCCC
Confidence 888876542 345555 677899999955444 444556778886543
No 417
>KOG2444 consensus WD40 repeat protein [General function prediction only]
Probab=93.87 E-value=0.23 Score=41.95 Aligned_cols=62 Identities=11% Similarity=0.193 Sum_probs=40.5
Q ss_pred CCCEEEEEeCCCeEEEEeCCCCcceEEeecCC-CCeEEEEEecCCCEEEEe--cCCCeEEEEEcC
Q 040274 78 FNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQ-GPVSALAFHPNGHLMATT--GKECKIKIWDLR 139 (359)
Q Consensus 78 ~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~-~~v~~l~~~p~g~~l~s~--~~d~~i~vwd~~ 139 (359)
++.+..+++.||.|+.|++.-.+.+...-.|+ .++..+..+..+.+++.+ |.|..++.|++.
T Consensus 113 ~~~~~c~~~~dg~ir~~n~~p~k~~g~~g~h~~~~~e~~ivv~sd~~i~~a~~S~d~~~k~W~ve 177 (238)
T KOG2444|consen 113 DSSLGCVGAQDGRIRACNIKPNKVLGYVGQHNFESGEELIVVGSDEFLKIADTSHDRVLKKWNVE 177 (238)
T ss_pred ccceeEEeccCCceeeeccccCceeeeeccccCCCcceeEEecCCceEEeeccccchhhhhcchh
Confidence 45678889999999999998777666655666 444444444444455554 555555555554
No 418
>PF07569 Hira: TUP1-like enhancer of split; InterPro: IPR011494 The Hira proteins are found in a range of eukaryotes and are implicated in the assembly of repressive chromatin. These proteins also contain IPR001680 from INTERPRO.; GO: 0006355 regulation of transcription, DNA-dependent, 0005634 nucleus
Probab=93.69 E-value=0.44 Score=40.80 Aligned_cols=57 Identities=11% Similarity=0.267 Sum_probs=37.6
Q ss_pred EecCCCEEEEecCCCeEEEEEcCCCeeeEee-------c----------CCceeEEEcCCC--cEEEEcCCcEEEEc
Q 040274 117 FHPNGHLMATTGKECKIKIWDLRKYEVLQTL-------T----------GHAKTLDFSQKG--LLAVGTGSFAQILG 174 (359)
Q Consensus 117 ~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~-------~----------~~v~~~~~s~~g--l~~~~~d~~i~v~d 174 (359)
+..++.+|++.+.+|.+++||+.+++++..- . ..|..+.++.+| +++. .+|..+.|+
T Consensus 18 l~~~~~~Ll~iT~~G~l~vWnl~~~k~~~~~~Si~pll~~~~~~~~~~~~~i~~~~lt~~G~PiV~l-sng~~y~y~ 93 (219)
T PF07569_consen 18 LECNGSYLLAITSSGLLYVWNLKKGKAVLPPVSIAPLLNSSPVSDKSSSPNITSCSLTSNGVPIVTL-SNGDSYSYS 93 (219)
T ss_pred EEeCCCEEEEEeCCCeEEEEECCCCeeccCCccHHHHhcccccccCCCCCcEEEEEEcCCCCEEEEE-eCCCEEEec
Confidence 4457889999999999999999987754332 1 224556666666 3333 335566665
No 419
>KOG2280 consensus Vacuolar assembly/sorting protein VPS16 [Intracellular trafficking, secretion, and vesicular transport]
Probab=93.55 E-value=3.6 Score=40.91 Aligned_cols=98 Identities=11% Similarity=0.224 Sum_probs=58.5
Q ss_pred eeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEe--e
Q 040274 70 TDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQT--L 147 (359)
Q Consensus 70 v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~--~ 147 (359)
..++..+|..-.=+. +.-..|+||++. |..+..+....+.+..+.|+.+. .|++...||++++|++-. ..+.. .
T Consensus 46 pIAV~r~p~~~~~~~-~a~~~I~If~~s-G~lL~~~~w~~~~lI~mgWs~~e-eLI~v~k~g~v~Vy~~~g-e~ie~~sv 121 (829)
T KOG2280|consen 46 PIAVTRSPSKLVPLY-SARPYIRIFNIS-GQLLGRILWKHGELIGMGWSDDE-ELICVQKDGTVHVYGLLG-EFIESNSV 121 (829)
T ss_pred ceEEEeccccccccc-ccceeEEEEecc-ccchHHHHhcCCCeeeecccCCc-eEEEEeccceEEEeecch-hhhccccc
Confidence 445555553321111 334568888865 67776666556688999998876 566778999999999752 22222 1
Q ss_pred -----cCCceeEEEcCCCcEEEEcCCcEE
Q 040274 148 -----TGHAKTLDFSQKGLLAVGTGSFAQ 171 (359)
Q Consensus 148 -----~~~v~~~~~s~~gl~~~~~d~~i~ 171 (359)
...|..+.+..+|+++-..+|.+.
T Consensus 122 g~e~~~~~I~ec~~f~~GVavlt~~g~v~ 150 (829)
T KOG2280|consen 122 GFESQMSDIVECRFFHNGVAVLTVSGQVI 150 (829)
T ss_pred ccccccCceeEEEEecCceEEEecCCcEE
Confidence 223555556667744444444433
No 420
>PRK10115 protease 2; Provisional
Probab=93.26 E-value=5.5 Score=40.45 Aligned_cols=105 Identities=10% Similarity=0.051 Sum_probs=63.0
Q ss_pred ceeEEEEcCCCCEEEEEeCC-C----eEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCC------CeEEEEE
Q 040274 69 RTDLMRVNPFNGVVSLGHSG-G----TVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKE------CKIKIWD 137 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~d-g----~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d------~~i~vwd 137 (359)
.+..+.|+|++++|+.+... | .|++.|+.++..+........ ..++|.+|+..|+.+..+ ..|++|+
T Consensus 128 ~l~~~~~Spdg~~la~~~d~~G~E~~~l~v~d~~tg~~l~~~i~~~~--~~~~w~~D~~~~~y~~~~~~~~~~~~v~~h~ 205 (686)
T PRK10115 128 TLGGMAITPDNTIMALAEDFLSRRQYGIRFRNLETGNWYPELLDNVE--PSFVWANDSWTFYYVRKHPVTLLPYQVWRHT 205 (686)
T ss_pred EEeEEEECCCCCEEEEEecCCCcEEEEEEEEECCCCCCCCccccCcc--eEEEEeeCCCEEEEEEecCCCCCCCEEEEEE
Confidence 57778899999988876532 3 588999988864433222222 569999998876655432 3688888
Q ss_pred cCCC--ee--eEeec-CCce-eEEEcCCC--cEEEE---cCCcEEEEcC
Q 040274 138 LRKY--EV--LQTLT-GHAK-TLDFSQKG--LLAVG---TGSFAQILGD 175 (359)
Q Consensus 138 ~~~~--~~--~~~~~-~~v~-~~~~s~~g--l~~~~---~d~~i~v~d~ 175 (359)
+.++ +. +..-. .... .+..+.++ ++..+ .++.+.+|+.
T Consensus 206 lgt~~~~d~lv~~e~~~~~~~~~~~s~d~~~l~i~~~~~~~~~~~l~~~ 254 (686)
T PRK10115 206 IGTPASQDELVYEEKDDTFYVSLHKTTSKHYVVIHLASATTSEVLLLDA 254 (686)
T ss_pred CCCChhHCeEEEeeCCCCEEEEEEEcCCCCEEEEEEECCccccEEEEEC
Confidence 8877 22 32222 2222 23334366 33222 2357888873
No 421
>PF14583 Pectate_lyase22: Oligogalacturonate lyase; PDB: 3C5M_C 3PE7_A.
Probab=93.19 E-value=1.6 Score=40.26 Aligned_cols=86 Identities=7% Similarity=-0.043 Sum_probs=44.6
Q ss_pred EEEEcCCCCEEEEE-eCCC--eEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCee--eEe
Q 040274 72 LMRVNPFNGVVSLG-HSGG--TVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEV--LQT 146 (359)
Q Consensus 72 ~l~~sp~~~~l~tg-~~dg--~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~--~~~ 146 (359)
.=+|.++|+.|+.+ ..|| .+.+.|+.+++..+.-.+.........++|+.+.++-......|...|+.+++. +..
T Consensus 40 ~~~ft~dG~kllF~s~~dg~~nly~lDL~t~~i~QLTdg~g~~~~g~~~s~~~~~~~Yv~~~~~l~~vdL~T~e~~~vy~ 119 (386)
T PF14583_consen 40 QNCFTDDGRKLLFASDFDGNRNLYLLDLATGEITQLTDGPGDNTFGGFLSPDDRALYYVKNGRSLRRVDLDTLEERVVYE 119 (386)
T ss_dssp S--B-TTS-EEEEEE-TTSS-EEEEEETTT-EEEE---SS-B-TTT-EE-TTSSEEEEEETTTEEEEEETTT--EEEEEE
T ss_pred CCCcCCCCCEEEEEeccCCCcceEEEEcccCEEEECccCCCCCccceEEecCCCeEEEEECCCeEEEEECCcCcEEEEEE
Confidence 34577888665554 4455 567778888875554433223333566788888887666667889999999765 444
Q ss_pred ecC-CceeEEEc
Q 040274 147 LTG-HAKTLDFS 157 (359)
Q Consensus 147 ~~~-~v~~~~~s 157 (359)
++. .+....|.
T Consensus 120 ~p~~~~g~gt~v 131 (386)
T PF14583_consen 120 VPDDWKGYGTWV 131 (386)
T ss_dssp --TTEEEEEEEE
T ss_pred CCccccccccee
Confidence 433 33345553
No 422
>PF10313 DUF2415: Uncharacterised protein domain (DUF2415); InterPro: IPR019417 This entry represents a short (30 residues) domain of unknown function found in a family of fungal proteins. It contains a characteristic DLL sequence motif.
Probab=93.04 E-value=0.36 Score=29.26 Aligned_cols=30 Identities=10% Similarity=0.205 Sum_probs=25.2
Q ss_pred ceeEEEEcCCC---CEEEEEeCCCeEEEEeCCC
Q 040274 69 RTDLMRVNPFN---GVVSLGHSGGTVTMWKPTT 98 (359)
Q Consensus 69 ~v~~l~~sp~~---~~l~tg~~dg~v~lwd~~~ 98 (359)
.|.+|.|+|.+ .+|+.+-..|.|.|+|+++
T Consensus 2 AvR~~kFsP~~~~~DLL~~~E~~g~vhi~D~R~ 34 (43)
T PF10313_consen 2 AVRCCKFSPEPGGNDLLAWAEHQGRVHIVDTRS 34 (43)
T ss_pred CeEEEEeCCCCCcccEEEEEccCCeEEEEEccc
Confidence 47899999854 4888888889999999985
No 423
>PHA03098 kelch-like protein; Provisional
Probab=93.00 E-value=3.5 Score=40.49 Aligned_cols=64 Identities=17% Similarity=0.193 Sum_probs=33.8
Q ss_pred CCCEEEEEeCC-----CeEEEEeCCCCcceEEeec-CCCCeEEEEEecCCCEEEEecCC------CeEEEEEcCCCe
Q 040274 78 FNGVVSLGHSG-----GTVTMWKPTTSALLIKMLY-HQGPVSALAFHPNGHLMATTGKE------CKIKIWDLRKYE 142 (359)
Q Consensus 78 ~~~~l~tg~~d-----g~v~lwd~~~~~~~~~~~~-h~~~v~~l~~~p~g~~l~s~~~d------~~i~vwd~~~~~ 142 (359)
++.+++.|+.+ ..+..||+.+.+....-.. +...-.+++ .-++.+++.||.+ ..+..||+.+.+
T Consensus 342 ~~~lyv~GG~~~~~~~~~v~~yd~~~~~W~~~~~lp~~r~~~~~~-~~~~~iYv~GG~~~~~~~~~~v~~yd~~t~~ 417 (534)
T PHA03098 342 NNRIYVIGGIYNSISLNTVESWKPGESKWREEPPLIFPRYNPCVV-NVNNLIYVIGGISKNDELLKTVECFSLNTNK 417 (534)
T ss_pred CCEEEEEeCCCCCEecceEEEEcCCCCceeeCCCcCcCCccceEE-EECCEEEEECCcCCCCcccceEEEEeCCCCe
Confidence 45566667654 3577888876543221111 111111222 2356677777732 458889987654
No 424
>KOG4441 consensus Proteins containing BTB/POZ and Kelch domains, involved in regulatory/signal transduction processes [Signal transduction mechanisms; General function prediction only]
Probab=92.93 E-value=1.6 Score=43.25 Aligned_cols=132 Identities=14% Similarity=0.087 Sum_probs=70.5
Q ss_pred CCCEEEEEeCC------CeEEEEeCCCCcceEEeec-CCCCeEEEEEecCCCEEEEecCC------CeEEEEEcCCCeee
Q 040274 78 FNGVVSLGHSG------GTVTMWKPTTSALLIKMLY-HQGPVSALAFHPNGHLMATTGKE------CKIKIWDLRKYEVL 144 (359)
Q Consensus 78 ~~~~l~tg~~d------g~v~lwd~~~~~~~~~~~~-h~~~v~~l~~~p~g~~l~s~~~d------~~i~vwd~~~~~~~ 144 (359)
.+.+++.|+.+ ..|..||+.++........ +.....++++. ++.+.++||.| .++..||.++.+-.
T Consensus 284 ~~~l~~vGG~~~~~~~~~~ve~yd~~~~~w~~~a~m~~~r~~~~~~~~-~~~lYv~GG~~~~~~~l~~ve~YD~~~~~W~ 362 (571)
T KOG4441|consen 284 SGKLVAVGGYNRQGQSLRSVECYDPKTNEWSSLAPMPSPRCRVGVAVL-NGKLYVVGGYDSGSDRLSSVERYDPRTNQWT 362 (571)
T ss_pred CCeEEEECCCCCCCcccceeEEecCCcCcEeecCCCCcccccccEEEE-CCEEEEEccccCCCcccceEEEecCCCCcee
Confidence 34566667665 3688899887744332221 22223344443 45778888888 35888998876632
Q ss_pred E--eecCCc--eeEEEcCCC--cEEEEcCC-----cEEEEcCCCCCccccccccccCCCCcceeEE-EEccCCCEEEEEe
Q 040274 145 Q--TLTGHA--KTLDFSQKG--LLAVGTGS-----FAQILGDFSGSHNYSRYMGNSMVKGYQIGKV-SFRPYEDVLGIGH 212 (359)
Q Consensus 145 ~--~~~~~v--~~~~~s~~g--l~~~~~d~-----~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~-~~sp~~~~l~~g~ 212 (359)
. .+...- ..++.. +| ++.||.|| +|..||..+........+.. ...+. .-.-+|.+.++|+
T Consensus 363 ~~a~M~~~R~~~~v~~l-~g~iYavGG~dg~~~l~svE~YDp~~~~W~~va~m~~------~r~~~gv~~~~g~iYi~GG 435 (571)
T KOG4441|consen 363 PVAPMNTKRSDFGVAVL-DGKLYAVGGFDGEKSLNSVECYDPVTNKWTPVAPMLT------RRSGHGVAVLGGKLYIIGG 435 (571)
T ss_pred ccCCccCccccceeEEE-CCEEEEEeccccccccccEEEecCCCCcccccCCCCc------ceeeeEEEEECCEEEEEcC
Confidence 2 111111 122221 34 66666664 68889865543222221111 11111 2223778888888
Q ss_pred CCCeE
Q 040274 213 SMGWS 217 (359)
Q Consensus 213 ~dg~~ 217 (359)
.++..
T Consensus 436 ~~~~~ 440 (571)
T KOG4441|consen 436 GDGSS 440 (571)
T ss_pred cCCCc
Confidence 77765
No 425
>PF12657 TFIIIC_delta: Transcription factor IIIC subunit delta N-term; InterPro: IPR024761 This entry represents a domain found towards the N terminus of the 90 kDa subunit of transcription factor IIIC (also known as subunit 9 in yeast []). The whole subunit is involved in RNA polymerase III-mediated transcription. It is possible that this N-terminal domain interacts with TFIIIC subunit 8 [].
Probab=92.49 E-value=1.2 Score=36.58 Aligned_cols=31 Identities=19% Similarity=0.264 Sum_probs=25.6
Q ss_pred ceeEEEEccCC------CEEEEEeCCCeEEEEEcCCC
Q 040274 195 QIGKVSFRPYE------DVLGIGHSMGWSGILVPRSS 225 (359)
Q Consensus 195 ~v~~~~~sp~~------~~l~~g~~dg~~~i~~~gs~ 225 (359)
.|.+++|||-| .+|++.+.+|.+.||.+...
T Consensus 87 ~vv~~aWSP~Gl~~~~rClLavLTs~~~l~l~~~~~~ 123 (173)
T PF12657_consen 87 QVVSAAWSPSGLGPNGRCLLAVLTSNGRLSLYGPPGN 123 (173)
T ss_pred cEEEEEECCCCCCCCCceEEEEEcCCCeEEEEecCCC
Confidence 69999999944 46888899999999988754
No 426
>KOG1897 consensus Damage-specific DNA binding complex, subunit DDB1 [Replication, recombination and repair]
Probab=92.44 E-value=9 Score=39.47 Aligned_cols=145 Identities=10% Similarity=0.069 Sum_probs=86.5
Q ss_pred ceeEEEEcCCCCEEEEEeCC--------------CeEEEEeCCCCcceEEeec-CC---CCeEEEEEecC-CCEEEEecC
Q 040274 69 RTDLMRVNPFNGVVSLGHSG--------------GTVTMWKPTTSALLIKMLY-HQ---GPVSALAFHPN-GHLMATTGK 129 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~d--------------g~v~lwd~~~~~~~~~~~~-h~---~~v~~l~~~p~-g~~l~s~~~ 129 (359)
....+++.+....+.+.+.. ..++++|.+|.+.+....- .. -.+.++.|..| +.+++.|..
T Consensus 716 ~prrI~~q~~sl~~~v~s~r~e~~~~~~~ee~~~s~l~vlD~nTf~vl~~hef~~~E~~~Si~s~~~~~d~~t~~vVGT~ 795 (1096)
T KOG1897|consen 716 SPRRICYQESSLTFGVLSNRIESSAEYYGEEYEVSFLRVLDQNTFEVLSSHEFERNETALSIISCKFTDDPNTYYVVGTG 795 (1096)
T ss_pred ChhheEecccceEEEEEecccccchhhcCCcceEEEEEEecCCceeEEeeccccccceeeeeeeeeecCCCceEEEEEEE
Confidence 56677777755445444321 1377888777654433221 11 23455557766 667776643
Q ss_pred ----------CCeEEEEEcCCCee---eEee--cCCceeEEEcCCCcEEEEcCCcEEEEcCCCCCccccccccccCCCCc
Q 040274 130 ----------ECKIKIWDLRKYEV---LQTL--TGHAKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGY 194 (359)
Q Consensus 130 ----------d~~i~vwd~~~~~~---~~~~--~~~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~ 194 (359)
.|.|.+|.+..+.. ++.. .+.+.++..- +|.+.++-+..|++|+.... +....-..+. .
T Consensus 796 ~v~Pde~ep~~GRIivfe~~e~~~L~~v~e~~v~Gav~aL~~f-ngkllA~In~~vrLye~t~~-~eLr~e~~~~----~ 869 (1096)
T KOG1897|consen 796 LVYPDENEPVNGRIIVFEFEELNSLELVAETVVKGAVYALVEF-NGKLLAGINQSVRLYEWTTE-RELRIECNIS----N 869 (1096)
T ss_pred eeccCCCCcccceEEEEEEecCCceeeeeeeeeccceeehhhh-CCeEEEecCcEEEEEEcccc-ceehhhhccc----C
Confidence 37788887766332 3322 4555555432 45566677889999996554 3333333332 2
Q ss_pred ceeEEEEccCCCEEEEEeCCCeEEE
Q 040274 195 QIGKVSFRPYEDVLGIGHSMGWSGI 219 (359)
Q Consensus 195 ~v~~~~~sp~~~~l~~g~~dg~~~i 219 (359)
++..+...-.|+.+++|.--+.+.+
T Consensus 870 ~~~aL~l~v~gdeI~VgDlm~Sitl 894 (1096)
T KOG1897|consen 870 PIIALDLQVKGDEIAVGDLMRSITL 894 (1096)
T ss_pred CeEEEEEEecCcEEEEeeccceEEE
Confidence 6788888888999999988777665
No 427
>PLN00033 photosystem II stability/assembly factor; Provisional
Probab=92.36 E-value=6.2 Score=37.08 Aligned_cols=118 Identities=14% Similarity=0.098 Sum_probs=73.9
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCc-----ceE
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSA-----LLI 103 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~-----~~~ 103 (359)
+.+..++||.+++.+.. .++.+.|.+++.+++++ .+|.+ +|....+. ...
T Consensus 242 ~~v~~~~dG~~~~vg~~G~~~~s~d~G~~~W~~~~~~~~~~l~~v~~~~dg~l~l~g-~~G~l-~~S~d~G~~~~~~~f~ 319 (398)
T PLN00033 242 STVNRSPDGDYVAVSSRGNFYLTWEPGQPYWQPHNRASARRIQNMGWRADGGLWLLT-RGGGL-YVSKGTGLTEEDFDFE 319 (398)
T ss_pred eeEEEcCCCCEEEEECCccEEEecCCCCcceEEecCCCccceeeeeEcCCCCEEEEe-CCceE-EEecCCCCccccccee
Confidence 55667788888887664 56788888888877666 45554 34444443 122
Q ss_pred Eeec--CCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeE------eecCCceeEEEcCCC-cEEEEcCCcEEEE
Q 040274 104 KMLY--HQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQ------TLTGHAKTLDFSQKG-LLAVGTGSFAQIL 173 (359)
Q Consensus 104 ~~~~--h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~------~~~~~v~~~~~s~~g-l~~~~~d~~i~v~ 173 (359)
.... ....++++.|.+++..++ ++.+|.+.... ..|+.-. .+..+.+.+.|.+++ .++.+.+|.|.-|
T Consensus 320 ~~~~~~~~~~l~~v~~~~d~~~~a-~G~~G~v~~s~-D~G~tW~~~~~~~~~~~~ly~v~f~~~~~g~~~G~~G~il~~ 396 (398)
T PLN00033 320 EADIKSRGFGILDVGYRSKKEAWA-AGGSGILLRST-DGGKSWKRDKGADNIAANLYSVKFFDDKKGFVLGNDGVLLRY 396 (398)
T ss_pred ecccCCCCcceEEEEEcCCCcEEE-EECCCcEEEeC-CCCcceeEccccCCCCcceeEEEEcCCCceEEEeCCcEEEEe
Confidence 2211 123588899988876554 45667666653 3333312 224567899988877 7778888877655
No 428
>PF14655 RAB3GAP2_N: Rab3 GTPase-activating protein regulatory subunit N-terminus
Probab=92.35 E-value=1.4 Score=41.33 Aligned_cols=42 Identities=10% Similarity=0.076 Sum_probs=35.9
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCC
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQG 110 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~ 110 (359)
.+.+++.+|++.+.++...=|.|.++|+.++..+..++|-.+
T Consensus 309 ~~~~i~~sP~~~laA~tDslGRV~LiD~~~~~vvrmWKGYRd 350 (415)
T PF14655_consen 309 EGESICLSPSGRLAAVTDSLGRVLLIDVARGIVVRMWKGYRD 350 (415)
T ss_pred eEEEEEECCCCCEEEEEcCCCcEEEEECCCChhhhhhccCcc
Confidence 577899999999988888889999999999988887776544
No 429
>PF12657 TFIIIC_delta: Transcription factor IIIC subunit delta N-term; InterPro: IPR024761 This entry represents a domain found towards the N terminus of the 90 kDa subunit of transcription factor IIIC (also known as subunit 9 in yeast []). The whole subunit is involved in RNA polymerase III-mediated transcription. It is possible that this N-terminal domain interacts with TFIIIC subunit 8 [].
Probab=92.33 E-value=0.69 Score=37.95 Aligned_cols=27 Identities=15% Similarity=0.282 Sum_probs=21.4
Q ss_pred CCceeEEEcCCC--------cEEEEcCCcEEEEcC
Q 040274 149 GHAKTLDFSQKG--------LLAVGTGSFAQILGD 175 (359)
Q Consensus 149 ~~v~~~~~s~~g--------l~~~~~d~~i~v~d~ 175 (359)
..+.+++|||.| |++.+.++.|.||..
T Consensus 86 ~~vv~~aWSP~Gl~~~~rClLavLTs~~~l~l~~~ 120 (173)
T PF12657_consen 86 SQVVSAAWSPSGLGPNGRCLLAVLTSNGRLSLYGP 120 (173)
T ss_pred ccEEEEEECCCCCCCCCceEEEEEcCCCeEEEEec
Confidence 368999999976 555667899999973
No 430
>COG3204 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=92.18 E-value=3.9 Score=36.18 Aligned_cols=115 Identities=11% Similarity=0.140 Sum_probs=75.7
Q ss_pred cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec----CCceeEEEcCCC-cEEEE-cCCcEEEEcCCCCCc
Q 040274 107 YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT----GHAKTLDFSQKG-LLAVG-TGSFAQILGDFSGSH 180 (359)
Q Consensus 107 ~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~----~~v~~~~~s~~g-l~~~~-~d~~i~v~d~~~~~~ 180 (359)
+-...|++++|+|+.+.|++......-.||=-..|+.+.+++ ...-.+.|..+| ++.+. .++.+.++.+.....
T Consensus 83 g~~~nvS~LTynp~~rtLFav~n~p~~iVElt~~GdlirtiPL~g~~DpE~Ieyig~n~fvi~dER~~~l~~~~vd~~t~ 162 (316)
T COG3204 83 GETANVSSLTYNPDTRTLFAVTNKPAAIVELTKEGDLIRTIPLTGFSDPETIEYIGGNQFVIVDERDRALYLFTVDADTT 162 (316)
T ss_pred cccccccceeeCCCcceEEEecCCCceEEEEecCCceEEEecccccCChhHeEEecCCEEEEEehhcceEEEEEEcCCcc
Confidence 445569999999999998888887777777556688888884 235678888888 44444 356777665433211
Q ss_pred ccc------ccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEc
Q 040274 181 NYS------RYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVP 222 (359)
Q Consensus 181 ~~~------~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~ 222 (359)
... ++..... .......++|+|.+..|..+-+..-+.|+..
T Consensus 163 ~~~~~~~~i~L~~~~k-~N~GfEGlA~d~~~~~l~~aKEr~P~~I~~~ 209 (316)
T COG3204 163 VISAKVQKIPLGTTNK-KNKGFEGLAWDPVDHRLFVAKERNPIGIFEV 209 (316)
T ss_pred EEeccceEEeccccCC-CCcCceeeecCCCCceEEEEEccCCcEEEEE
Confidence 111 1111110 1234678999999988888877776666544
No 431
>PHA02713 hypothetical protein; Provisional
Probab=92.01 E-value=3.1 Score=41.12 Aligned_cols=65 Identities=9% Similarity=0.001 Sum_probs=35.3
Q ss_pred CCCEEEEEeCC------CeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCC-----eEEEEEcCCCe
Q 040274 78 FNGVVSLGHSG------GTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKEC-----KIKIWDLRKYE 142 (359)
Q Consensus 78 ~~~~l~tg~~d------g~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~-----~i~vwd~~~~~ 142 (359)
++.+++.|+.+ ..|..||+.+......-.............-+|.+.+.||.++ .+..||..+..
T Consensus 303 ~~~IYviGG~~~~~~~~~~v~~Yd~~~n~W~~~~~m~~~R~~~~~~~~~g~IYviGG~~~~~~~~sve~Ydp~~~~ 378 (557)
T PHA02713 303 DNEIIIAGGYNFNNPSLNKVYKINIENKIHVELPPMIKNRCRFSLAVIDDTIYAIGGQNGTNVERTIECYTMGDDK 378 (557)
T ss_pred CCEEEEEcCCCCCCCccceEEEEECCCCeEeeCCCCcchhhceeEEEECCEEEEECCcCCCCCCceEEEEECCCCe
Confidence 45566777753 3477888877643211111111111111223677778887654 48889988654
No 432
>TIGR03606 non_repeat_PQQ dehydrogenase, PQQ-dependent, s-GDH family. PQQ, or pyrroloquinoline-quinone, serves as a cofactor for a number of sugar and alcohol dehydrogenases in a limited number of bacterial species. Most characterized PQQ-dependent enzymes have multiple repeats of a sequence region described by pfam01011 (PQQ enzyme repeat), but this protein family in unusual in lacking that repeat. Below the noise cutoff are related proteins mostly from species that lack PQQ biosynthesis.
Probab=91.98 E-value=12 Score=35.82 Aligned_cols=59 Identities=15% Similarity=0.190 Sum_probs=39.4
Q ss_pred EEEeccceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcc--eEEee-----cCCCCeEEEEEecCC
Q 040274 63 MAVAGRRTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSAL--LIKML-----YHQGPVSALAFHPNG 121 (359)
Q Consensus 63 l~~~~~~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~--~~~~~-----~h~~~v~~l~~~p~g 121 (359)
++++-...+.|+|.|++.+|++--..|.|++++..++.. +..+. ...+....|+++|+-
T Consensus 25 va~GL~~Pw~maflPDG~llVtER~~G~I~~v~~~~~~~~~~~~l~~v~~~~ge~GLlglal~PdF 90 (454)
T TIGR03606 25 LLSGLNKPWALLWGPDNQLWVTERATGKILRVNPETGEVKVVFTLPEIVNDAQHNGLLGLALHPDF 90 (454)
T ss_pred EECCCCCceEEEEcCCCeEEEEEecCCEEEEEeCCCCceeeeecCCceeccCCCCceeeEEECCCc
Confidence 333334788999999998777765569999998665432 21111 125668899999874
No 433
>PF07995 GSDH: Glucose / Sorbosone dehydrogenase; InterPro: IPR012938 Proteins containing this domain are thought to be glucose/sorbosone dehydrogenases. The best characterised of these proteins is soluble glucose dehydrogenase (P13650 from SWISSPROT) from Acinetobacter calcoaceticus, which oxidises glucose to gluconolactone. The enzyme is a calcium-dependent homodimer which uses PQQ as a cofactor [].; GO: 0016901 oxidoreductase activity, acting on the CH-OH group of donors, quinone or similar compound as acceptor, 0048038 quinone binding, 0005975 carbohydrate metabolic process; PDB: 2ISM_A 2WG3_D 3HO5_A 3HO4_A 3HO3_A 2WFT_A 2WG4_B 2WFX_B 1CRU_A 1CQ1_B ....
Probab=91.92 E-value=9.9 Score=34.80 Aligned_cols=96 Identities=22% Similarity=0.311 Sum_probs=51.5
Q ss_pred eeEEEEcCCCCEEEEEeCCCeEEEEeCCCCc--ceEEe----ecCCCCeEEEEEecC----CCEEEEecCC--------C
Q 040274 70 TDLMRVNPFNGVVSLGHSGGTVTMWKPTTSA--LLIKM----LYHQGPVSALAFHPN----GHLMATTGKE--------C 131 (359)
Q Consensus 70 v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~--~~~~~----~~h~~~v~~l~~~p~----g~~l~s~~~d--------~ 131 (359)
.++|+|.|+|.+|++ ...|.|.+++..... .+..+ .........++++|+ +.+.++.+.. .
T Consensus 4 P~~~a~~pdG~l~v~-e~~G~i~~~~~~g~~~~~v~~~~~v~~~~~~gllgia~~p~f~~n~~lYv~~t~~~~~~~~~~~ 82 (331)
T PF07995_consen 4 PRSMAFLPDGRLLVA-ERSGRIWVVDKDGSLKTPVADLPEVFADGERGLLGIAFHPDFASNGYLYVYYTNADEDGGDNDN 82 (331)
T ss_dssp EEEEEEETTSCEEEE-ETTTEEEEEETTTEECEEEEE-TTTBTSTTBSEEEEEE-TTCCCC-EEEEEEEEE-TSSSSEEE
T ss_pred ceEEEEeCCCcEEEE-eCCceEEEEeCCCcCcceecccccccccccCCcccceeccccCCCCEEEEEEEcccCCCCCcce
Confidence 468999999877665 558999999833222 12222 133456799999994 4333333321 2
Q ss_pred eEEEEEcCCC-------eee-EeecC-----C-ceeEEEcCCC--cEEEEc
Q 040274 132 KIKIWDLRKY-------EVL-QTLTG-----H-AKTLDFSQKG--LLAVGT 166 (359)
Q Consensus 132 ~i~vwd~~~~-------~~~-~~~~~-----~-v~~~~~s~~g--l~~~~~ 166 (359)
.|.-|..... +.+ ..++. | ...|.|.|+| +++.+.
T Consensus 83 ~v~r~~~~~~~~~~~~~~~l~~~~p~~~~~~H~g~~l~fgpDG~LYvs~G~ 133 (331)
T PF07995_consen 83 RVVRFTLSDGDGDLSSEEVLVTGLPDTSSGNHNGGGLAFGPDGKLYVSVGD 133 (331)
T ss_dssp EEEEEEEETTSCEEEEEEEEEEEEES-CSSSS-EEEEEE-TTSEEEEEEB-
T ss_pred eeEEEeccCCccccccceEEEEEeCCCCCCCCCCccccCCCCCcEEEEeCC
Confidence 3554544332 111 11121 2 3679999999 455543
No 434
>COG4257 Vgb Streptogramin lyase [Defense mechanisms]
Probab=91.85 E-value=8.4 Score=33.86 Aligned_cols=164 Identities=13% Similarity=0.070 Sum_probs=88.3
Q ss_pred eEEEECCCCCEEEEecc-----------------------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee--
Q 040274 52 ILWILPSSGRYMAVAGR-----------------------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML-- 106 (359)
Q Consensus 52 ~~l~~spdg~~l~~~~~-----------------------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~-- 106 (359)
|+++.+|||..-.++.. .-+.+...||+..-++-+.. .|.-.|..+.+. ..|.
T Consensus 65 ~dvapapdG~VWft~qg~gaiGhLdP~tGev~~ypLg~Ga~Phgiv~gpdg~~Witd~~~-aI~R~dpkt~ev-t~f~lp 142 (353)
T COG4257 65 FDVAPAPDGAVWFTAQGTGAIGHLDPATGEVETYPLGSGASPHGIVVGPDGSAWITDTGL-AIGRLDPKTLEV-TRFPLP 142 (353)
T ss_pred cccccCCCCceEEecCccccceecCCCCCceEEEecCCCCCCceEEECCCCCeeEecCcc-eeEEecCcccce-EEeecc
Confidence 99999999976665443 44555566665543333222 444445544432 2221
Q ss_pred --cCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec----CCceeEEEcCCC--cEEEEcCCcEEEEcCCCC
Q 040274 107 --YHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT----GHAKTLDFSQKG--LLAVGTGSFAQILGDFSG 178 (359)
Q Consensus 107 --~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~----~~v~~~~~s~~g--l~~~~~d~~i~v~d~~~~ 178 (359)
..........|.+.|++-+|+.. |.---.|..+ ..+..|+ ...+.||..|+| +++.-.++.|-..|....
T Consensus 143 ~~~a~~nlet~vfD~~G~lWFt~q~-G~yGrLdPa~-~~i~vfpaPqG~gpyGi~atpdGsvwyaslagnaiaridp~~~ 220 (353)
T COG4257 143 LEHADANLETAVFDPWGNLWFTGQI-GAYGRLDPAR-NVISVFPAPQGGGPYGICATPDGSVWYASLAGNAIARIDPFAG 220 (353)
T ss_pred cccCCCcccceeeCCCccEEEeecc-ccceecCccc-CceeeeccCCCCCCcceEECCCCcEEEEeccccceEEcccccC
Confidence 23456778889999998888753 1111111111 1233331 235889999999 444445677777775544
Q ss_pred CccccccccccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEc
Q 040274 179 SHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVP 222 (359)
Q Consensus 179 ~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~ 222 (359)
.......... ....-..+--+|.|..-++....+.+..+.+
T Consensus 221 ~aev~p~P~~---~~~gsRriwsdpig~~wittwg~g~l~rfdP 261 (353)
T COG4257 221 HAEVVPQPNA---LKAGSRRIWSDPIGRAWITTWGTGSLHRFDP 261 (353)
T ss_pred CcceecCCCc---ccccccccccCccCcEEEeccCCceeeEeCc
Confidence 2222221111 0112344555677777777666666655554
No 435
>PF05096 Glu_cyclase_2: Glutamine cyclotransferase; InterPro: IPR007788 This family of enzymes 2.3.2.5 from EC catalyse the cyclization of free L-glutamine and N-terminal glutaminyl residues in proteins to pyroglutamate (5-oxoproline) and pyroglutamyl residues respectively []. This family includes plant and bacterial enzymes and seems unrelated to the mammalian enzymes.; PDB: 3NOK_B 2FAW_A 2IWA_A 3NOM_A 3NOL_A 3MBR_X.
Probab=91.57 E-value=8.9 Score=33.61 Aligned_cols=120 Identities=14% Similarity=0.193 Sum_probs=68.9
Q ss_pred EeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec--------CCceeEEE
Q 040274 85 GHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT--------GHAKTLDF 156 (359)
Q Consensus 85 g~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~--------~~v~~~~~ 156 (359)
.-.++...+||..+.+.+..+.- .+.=+.++ .+|..|+.+.....|+++|..+.+.+..+. ..++-+.|
T Consensus 106 TWk~~~~f~yd~~tl~~~~~~~y-~~EGWGLt--~dg~~Li~SDGS~~L~~~dP~~f~~~~~i~V~~~g~pv~~LNELE~ 182 (264)
T PF05096_consen 106 TWKEGTGFVYDPNTLKKIGTFPY-PGEGWGLT--SDGKRLIMSDGSSRLYFLDPETFKEVRTIQVTDNGRPVSNLNELEY 182 (264)
T ss_dssp ESSSSEEEEEETTTTEEEEEEE--SSS--EEE--ECSSCEEEE-SSSEEEEE-TTT-SEEEEEE-EETTEE---EEEEEE
T ss_pred EecCCeEEEEccccceEEEEEec-CCcceEEE--cCCCEEEEECCccceEEECCcccceEEEEEEEECCEECCCcEeEEE
Confidence 33578899999999888888754 34456776 467778887778899999998887766661 12456666
Q ss_pred cCCC-cEEEEc-CCcEEEEcCCCCCcccccc-----cc------ccCCCCcceeEEEEccCCCEEE
Q 040274 157 SQKG-LLAVGT-GSFAQILGDFSGSHNYSRY-----MG------NSMVKGYQIGKVSFRPYEDVLG 209 (359)
Q Consensus 157 s~~g-l~~~~~-d~~i~v~d~~~~~~~~~~~-----~~------~~~~~~~~v~~~~~sp~~~~l~ 209 (359)
- +| +++--+ ...|...|..++ .....+ .. ...+...-.+.++|.|..+.|.
T Consensus 183 i-~G~IyANVW~td~I~~Idp~tG-~V~~~iDls~L~~~~~~~~~~~~~~dVLNGIAyd~~~~~l~ 246 (264)
T PF05096_consen 183 I-NGKIYANVWQTDRIVRIDPETG-KVVGWIDLSGLRPEVGRDKSRQPDDDVLNGIAYDPETDRLF 246 (264)
T ss_dssp E-TTEEEEEETTSSEEEEEETTT--BEEEEEE-HHHHHHHTSTTST--TTS-EEEEEEETTTTEEE
T ss_pred E-cCEEEEEeCCCCeEEEEeCCCC-eEEEEEEhhHhhhcccccccccccCCeeEeEeEeCCCCEEE
Confidence 5 55 444333 455666664443 222111 00 0000123578899999876443
No 436
>PF08728 CRT10: CRT10; InterPro: IPR014839 CRT10 is a transcriptional regulator of ribonucleotide reductase (RNR) genes []. RNR catalyses the rate limiting step in dNTP synthesis. Mutations in CRT10 have been shown to enhance hydroxyurea resistance [].
Probab=91.55 E-value=11 Score=37.94 Aligned_cols=99 Identities=13% Similarity=0.121 Sum_probs=58.2
Q ss_pred CCCEEEEecCCCeEEEEEcCC-------C-------------eeeEee--cCCceeEEEc--CCC-cEEEEcC-CcEEEE
Q 040274 120 NGHLMATTGKECKIKIWDLRK-------Y-------------EVLQTL--TGHAKTLDFS--QKG-LLAVGTG-SFAQIL 173 (359)
Q Consensus 120 ~g~~l~s~~~d~~i~vwd~~~-------~-------------~~~~~~--~~~v~~~~~s--~~g-l~~~~~d-~~i~v~ 173 (359)
+...|+.|..||.|.+|.+.+ . ++...+ ...+++++++ ... ++++|.+ ..|.||
T Consensus 113 ~~EVLl~c~DdG~V~~Yyt~~I~~~i~~~~~~~~~~~~r~~i~P~f~~~v~~SaWGLdIh~~~~~rlIAVSsNs~~VTVF 192 (717)
T PF08728_consen 113 GEEVLLLCTDDGDVLAYYTETIIEAIERFSEDNDSGFSRLKIKPFFHLRVGASAWGLDIHDYKKSRLIAVSSNSQEVTVF 192 (717)
T ss_pred CeeEEEEEecCCeEEEEEHHHHHHHHHhhccccccccccccCCCCeEeecCCceeEEEEEecCcceEEEEecCCceEEEE
Confidence 445788899999999996521 1 011111 4467899988 555 6666654 566665
Q ss_pred cCCCCCccccccccccCCCCcceeEEEEccCC---C---EEEEEeCCCeEEEE
Q 040274 174 GDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYE---D---VLGIGHSMGWSGIL 220 (359)
Q Consensus 174 d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~---~---~l~~g~~dg~~~i~ 220 (359)
-.............+. +...|.+|+|.++. . +|++++-.|.+.+|
T Consensus 193 af~l~~~r~~~~~s~~--~~hNIP~VSFl~~~~d~~G~v~v~a~dI~G~v~~~ 243 (717)
T PF08728_consen 193 AFALVDERFYHVPSHQ--HSHNIPNVSFLDDDLDPNGHVKVVATDISGEVWTF 243 (717)
T ss_pred EEeccccccccccccc--cccCCCeeEeecCCCCCccceEEEEEeccCcEEEE
Confidence 4322111111111221 23368999998854 2 77788888876653
No 437
>KOG4499 consensus Ca2+-binding protein Regucalcin/SMP30 [Inorganic ion transport and metabolism; Signal transduction mechanisms]
Probab=91.33 E-value=1.4 Score=37.55 Aligned_cols=48 Identities=23% Similarity=0.360 Sum_probs=41.2
Q ss_pred eEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEe
Q 040274 71 DLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFH 118 (359)
Q Consensus 71 ~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~ 118 (359)
-.|++..+|.+.+++-+.|+|...|+.+|+.+..+.-.+..|+|++|-
T Consensus 215 DGm~ID~eG~L~Va~~ng~~V~~~dp~tGK~L~eiklPt~qitsccFg 262 (310)
T KOG4499|consen 215 DGMTIDTEGNLYVATFNGGTVQKVDPTTGKILLEIKLPTPQITSCCFG 262 (310)
T ss_pred CcceEccCCcEEEEEecCcEEEEECCCCCcEEEEEEcCCCceEEEEec
Confidence 345556678888888888999999999999999999889999999994
No 438
>PHA02790 Kelch-like protein; Provisional
Probab=91.12 E-value=5.7 Score=38.47 Aligned_cols=130 Identities=12% Similarity=-0.032 Sum_probs=59.0
Q ss_pred CCCEEEEEeCC--CeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCC---eEEEEEcCCCeeeE--eecCC
Q 040274 78 FNGVVSLGHSG--GTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKEC---KIKIWDLRKYEVLQ--TLTGH 150 (359)
Q Consensus 78 ~~~~l~tg~~d--g~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~---~i~vwd~~~~~~~~--~~~~~ 150 (359)
+|.+.+.|+.+ .++..||+.+++....-.............-+|.+.+.||.++ .+..||..+..-.. ..+.+
T Consensus 318 ~~~iYviGG~~~~~sve~ydp~~n~W~~~~~l~~~r~~~~~~~~~g~IYviGG~~~~~~~ve~ydp~~~~W~~~~~m~~~ 397 (480)
T PHA02790 318 NNKLYVVGGLPNPTSVERWFHGDAAWVNMPSLLKPRCNPAVASINNVIYVIGGHSETDTTTEYLLPNHDQWQFGPSTYYP 397 (480)
T ss_pred CCEEEEECCcCCCCceEEEECCCCeEEECCCCCCCCcccEEEEECCEEEEecCcCCCCccEEEEeCCCCEEEeCCCCCCc
Confidence 44555666643 3578888776533221111111111111223677777777653 47788887654322 11111
Q ss_pred c-eeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 151 A-KTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 151 v-~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
. ...+..-+| +++.| |.+.+||..+.......-+.. +..... ++ .-+|.+.++|+.+
T Consensus 398 r~~~~~~~~~~~IYv~G--G~~e~ydp~~~~W~~~~~m~~---~r~~~~-~~-v~~~~IYviGG~~ 456 (480)
T PHA02790 398 HYKSCALVFGRRLFLVG--RNAEFYCESSNTWTLIDDPIY---PRDNPE-LI-IVDNKLLLIGGFY 456 (480)
T ss_pred cccceEEEECCEEEEEC--CceEEecCCCCcEeEcCCCCC---CccccE-EE-EECCEEEEECCcC
Confidence 1 111222345 44433 457888865543222111111 111121 22 2367777777765
No 439
>COG3823 Glutamine cyclotransferase [Posttranslational modification, protein turnover, chaperones]
Probab=90.90 E-value=3.8 Score=34.37 Aligned_cols=98 Identities=15% Similarity=0.046 Sum_probs=57.0
Q ss_pred CCCEEEEEeC--CCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEE-ecCCCeEEEEEcCCCeeeEee--cCCce
Q 040274 78 FNGVVSLGHS--GGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMAT-TGKECKIKIWDLRKYEVLQTL--TGHAK 152 (359)
Q Consensus 78 ~~~~l~tg~~--dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s-~~~d~~i~vwd~~~~~~~~~~--~~~v~ 152 (359)
+|.++.+.+. ...|++||+.+++.+.+-.-....+..-....-|.++.. .-.+|.-.++|.++.+++..+ ++.-+
T Consensus 55 ~g~i~esTG~yg~S~ir~~~L~~gq~~~s~~l~~~~~FgEGit~~gd~~y~LTw~egvaf~~d~~t~~~lg~~~y~GeGW 134 (262)
T COG3823 55 DGHILESTGLYGFSKIRVSDLTTGQEIFSEKLAPDTVFGEGITKLGDYFYQLTWKEGVAFKYDADTLEELGRFSYEGEGW 134 (262)
T ss_pred CCEEEEeccccccceeEEEeccCceEEEEeecCCccccccceeeccceEEEEEeccceeEEEChHHhhhhcccccCCcce
Confidence 3445555543 346999999999877654422222222222122333332 346788999999998887766 55566
Q ss_pred eEEEcCCCcEEEEcCCcEEEEcC
Q 040274 153 TLDFSQKGLLAVGTGSFAQILGD 175 (359)
Q Consensus 153 ~~~~s~~gl~~~~~d~~i~v~d~ 175 (359)
.++.....++.+....+++.-|.
T Consensus 135 gLt~d~~~LimsdGsatL~frdP 157 (262)
T COG3823 135 GLTSDDKNLIMSDGSATLQFRDP 157 (262)
T ss_pred eeecCCcceEeeCCceEEEecCH
Confidence 66654444655555556665553
No 440
>TIGR03075 PQQ_enz_alc_DH PQQ-dependent dehydrogenase, methanol/ethanol family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Genes in this family often are found adjacent to the PQQ biosynthesis genes themselves. An unusual, strained disulfide bond between adjacent Cys residues contributes to PQQ-binding, as does a Trp residue that is part of a PQQ enzyme repeat (see pfam01011). Characterized members include the dehydrogenase subunit of a membrane-anchored, three subunit alcohol (ethanol) dehydrogenase of Gluconobacter suboxydans, a homodimeric ethanol dehydrogenase in Pseudomonas aeruginosa, and the large subunit of an alpha2/beta2 heterotetrameric methanol dehydrogenase in Methylobacterium extorquens.
Probab=90.89 E-value=3 Score=40.89 Aligned_cols=60 Identities=18% Similarity=0.226 Sum_probs=42.9
Q ss_pred CCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeec
Q 040274 88 GGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLT 148 (359)
Q Consensus 88 dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~ 148 (359)
-|.|.-+|+.+++.+..+........+. +.-.+.+++.++.||.++.+|..+|+.+..+.
T Consensus 440 ~g~l~AiD~~tGk~~W~~~~~~p~~~~~-l~t~g~lvf~g~~~G~l~a~D~~TGe~lw~~~ 499 (527)
T TIGR03075 440 MGSLIAWDPITGKIVWEHKEDFPLWGGV-LATAGDLVFYGTLEGYFKAFDAKTGEELWKFK 499 (527)
T ss_pred ceeEEEEeCCCCceeeEecCCCCCCCcc-eEECCcEEEEECCCCeEEEEECCCCCEeEEEe
Confidence 3678999999998887765322212222 11245577778889999999999999988873
No 441
>PF11715 Nup160: Nucleoporin Nup120/160; InterPro: IPR021717 Nup120 is conserved from fungi to plants to humans, and is homologous with the Nup160 of vertebrates. The nuclear core complex, or NPC, mediates macromolecular transport across the nuclear envelope. Deletion of the NUP120 gene causes clustering of NPCs at one side of the nuclear envelope, moderate nucleolar fragmentation and slower cell growth []. The vertebrate NPC is estimated to contain between 30 and 60 different proteins. most of which are not known. Two important ones in creating the nucleoporin basket are Nup98 and Nup153, and Nup120, in conjunction with Nup 133, interacts with these two and itself plays a role in mRNA export []. Nup160, Nup133, Nup96, and Nup107 are all targets of phosphorylation. The phosphorylation sites are clustered mainly at the N-terminal regions of these proteins, which are predicted to be natively disordered. The entire Nup107-160 subcomplex is stable throughout the cell cycle, thus it seems unlikely that phosphorylation affects interactions within the Nup107-160 subcomplex, but rather that it regulates the association of the subcomplex with the NPC and other proteins []. ; PDB: 3F7F_D 3H7N_D 3HXR_A.
Probab=90.67 E-value=1.1 Score=44.06 Aligned_cols=71 Identities=14% Similarity=0.299 Sum_probs=43.2
Q ss_pred CCCCEEEEEeCCCeEEEEeCCC----CcceEE-ee-c--------------------CCCCeEEEEEec----CCCEEEE
Q 040274 77 PFNGVVSLGHSGGTVTMWKPTT----SALLIK-ML-Y--------------------HQGPVSALAFHP----NGHLMAT 126 (359)
Q Consensus 77 p~~~~l~tg~~dg~v~lwd~~~----~~~~~~-~~-~--------------------h~~~v~~l~~~p----~g~~l~s 126 (359)
++...++.+..||.+....... +..... .. . ..+.+.++++++ +..++++
T Consensus 156 ~~~~~l~v~~~dG~ll~l~~~~~~~~~~~~~~~~~~~~~~~~~l~g~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~t 235 (547)
T PF11715_consen 156 DSEANLVVSLQDGGLLRLKRSSGDSDGSVWSEELFNDSSWLRSLSGLFPWSYRGDNSSSSVAASLAVSSSEINDDTFLFT 235 (547)
T ss_dssp -SSSBEEEEESSS-EEEEEES----SSS-EE----STHHHHHCCTTTS-TT---SSSS---EEEEEE-----ETTTEEEE
T ss_pred cCCCEEEEEECCCCeEEEECCcccCCCCeeEEEEeCCCchhhhhhCcCCcccccCCCCCCccceEEEecceeCCCCEEEE
Confidence 4566777778888877766543 111110 00 0 123456666666 6789999
Q ss_pred ecCCCeEEEEEcCCCeeeEee
Q 040274 127 TGKECKIKIWDLRKYEVLQTL 147 (359)
Q Consensus 127 ~~~d~~i~vwd~~~~~~~~~~ 147 (359)
.+.|+++++||+.++.++.+.
T Consensus 236 l~~D~~LRiW~l~t~~~~~~~ 256 (547)
T PF11715_consen 236 LSRDHTLRIWSLETGQCLATI 256 (547)
T ss_dssp EETTSEEEEEETTTTCEEEEE
T ss_pred EeCCCeEEEEECCCCeEEEEe
Confidence 999999999999999986654
No 442
>PF14761 HPS3_N: Hermansky-Pudlak syndrome 3
Probab=90.20 E-value=10 Score=32.01 Aligned_cols=96 Identities=17% Similarity=0.236 Sum_probs=59.4
Q ss_pred CEEEEEeCCCeEEEEeCCCC--cceEEeecCCCCeEEEEEecCCCEEEEecCC---C---eEEEE---EcC--CCeeeE-
Q 040274 80 GVVSLGHSGGTVTMWKPTTS--ALLIKMLYHQGPVSALAFHPNGHLMATTGKE---C---KIKIW---DLR--KYEVLQ- 145 (359)
Q Consensus 80 ~~l~tg~~dg~v~lwd~~~~--~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d---~---~i~vw---d~~--~~~~~~- 145 (359)
..|+.+...+.|.+|++.+. .++..|.. -+.|..+.++..|.|++|--.+ . .+++| +.. ...++.
T Consensus 29 d~Lfva~~g~~Vev~~l~~~~~~~~~~F~T-v~~V~~l~y~~~GDYlvTlE~k~~~~~~~fvR~Y~NWr~~~~~~~~v~v 107 (215)
T PF14761_consen 29 DALFVAASGCKVEVYDLEQEECPLLCTFST-VGRVLQLVYSEAGDYLVTLEEKNKRSPVDFVRAYFNWRSQKEENSPVRV 107 (215)
T ss_pred ceEEEEcCCCEEEEEEcccCCCceeEEEcc-hhheeEEEeccccceEEEEEeecCCccceEEEEEEEhhhhcccCCcEEE
Confidence 34444455678999998833 44555644 5889999999999999996432 2 56665 221 011111
Q ss_pred ----------------------ee--cCCceeEEEcCC-CcEEEEcCCcEEEEcCC
Q 040274 146 ----------------------TL--TGHAKTLDFSQK-GLLAVGTGSFAQILGDF 176 (359)
Q Consensus 146 ----------------------~~--~~~v~~~~~s~~-gl~~~~~d~~i~v~d~~ 176 (359)
.+ ..++.+++..|- |=+.++.++.+.+|.+.
T Consensus 108 RiaG~~v~~~~~~~~~~qleiiElPl~~~p~ciaCC~~tG~LlVg~~~~l~lf~l~ 163 (215)
T PF14761_consen 108 RIAGHRVTPSFNESSKDQLEIIELPLSEPPLCIACCPVTGNLLVGCGNKLVLFTLK 163 (215)
T ss_pred EEcccccccCCCCccccceEEEEecCCCCCCEEEecCCCCCEEEEcCCEEEEEEEE
Confidence 11 234577777774 44555667788888753
No 443
>PF05694 SBP56: 56kDa selenium binding protein (SBP56); InterPro: IPR008826 This family consists of several eukaryotic selenium binding proteins as well as three sequences from archaea. The exact function of this protein is unknown although it is thought that SBP56 participates in late stages of intra-Golgi protein transport []. The Lotus japonicus homologue of SBP56, LjSBP is thought to have more than one physiological role and can be implicated in controlling the oxidation/reduction status of target proteins in vesicular Golgi transport [].; GO: 0008430 selenium binding; PDB: 2ECE_A.
Probab=90.09 E-value=17 Score=34.29 Aligned_cols=145 Identities=12% Similarity=0.072 Sum_probs=70.9
Q ss_pred cCCCCEEEEEe--CC----CeEEEEeCCCCcceEEeecC---CCCeEEEEEecCCCEEEEecC-----------------
Q 040274 76 NPFNGVVSLGH--SG----GTVTMWKPTTSALLIKMLYH---QGPVSALAFHPNGHLMATTGK----------------- 129 (359)
Q Consensus 76 sp~~~~l~tg~--~d----g~v~lwd~~~~~~~~~~~~h---~~~v~~l~~~p~g~~l~s~~~----------------- 129 (359)
-|+|.+++++- .+ |.+.++|-.+.......... ...-+.+-|.|..+.++|+..
T Consensus 138 lp~G~imIS~lGd~~G~g~Ggf~llD~~tf~v~g~We~~~~~~~~gYDfw~qpr~nvMiSSeWg~P~~~~~Gf~~~d~~~ 217 (461)
T PF05694_consen 138 LPDGRIMISALGDADGNGPGGFVLLDGETFEVKGRWEKDRGPQPFGYDFWYQPRHNVMISSEWGAPSMFEKGFNPEDLEA 217 (461)
T ss_dssp -SS--EEEEEEEETTS-S--EEEEE-TTT--EEEE--SB-TT------EEEETTTTEEEE-B---HHHHTT---TTTHHH
T ss_pred cCCccEEEEeccCCCCCCCCcEEEEcCccccccceeccCCCCCCCCCCeEEcCCCCEEEEeccCChhhcccCCChhHhhc
Confidence 46787777743 22 46888888877776665532 233467778898888988743
Q ss_pred ---CCeEEEEEcCCCeeeEeec----C-CceeEEEcC--CC---cEEEEcCCcEEEEcC-CCCCcc---ccccc------
Q 040274 130 ---ECKIKIWDLRKYEVLQTLT----G-HAKTLDFSQ--KG---LLAVGTGSFAQILGD-FSGSHN---YSRYM------ 186 (359)
Q Consensus 130 ---d~~i~vwd~~~~~~~~~~~----~-~v~~~~~s~--~g---l~~~~~d~~i~v~d~-~~~~~~---~~~~~------ 186 (359)
-.++.+||+.+.+.++++. + -+..+.|.. +. ++.+...++|..|-- ..+... +..+.
T Consensus 218 ~~yG~~l~vWD~~~r~~~Q~idLg~~g~~pLEvRflH~P~~~~gFvg~aLss~i~~~~k~~~g~W~a~kVi~ip~~~v~~ 297 (461)
T PF05694_consen 218 GKYGHSLHVWDWSTRKLLQTIDLGEEGQMPLEVRFLHDPDANYGFVGCALSSSIWRFYKDDDGEWAAEKVIDIPAKKVEG 297 (461)
T ss_dssp H-S--EEEEEETTTTEEEEEEES-TTEEEEEEEEE-SSTT--EEEEEEE--EEEEEEEE-ETTEEEEEEEEEE--EE--S
T ss_pred ccccCeEEEEECCCCcEeeEEecCCCCCceEEEEecCCCCccceEEEEeccceEEEEEEcCCCCeeeeEEEECCCcccCc
Confidence 2579999999999999982 1 244566644 33 676666666666542 111110 00010
Q ss_pred --------cccCCCCcceeEEEEccCCCEEEEEeC-CCeEEEEE
Q 040274 187 --------GNSMVKGYQIGKVSFRPYEDVLGIGHS-MGWSGILV 221 (359)
Q Consensus 187 --------~~~~~~~~~v~~~~~sp~~~~l~~g~~-dg~~~i~~ 221 (359)
.... ...-|+.+..|.|.++|.+++. .|.++-|.
T Consensus 298 ~~lp~ml~~~~~-~P~LitDI~iSlDDrfLYvs~W~~GdvrqYD 340 (461)
T PF05694_consen 298 WILPEMLKPFGA-VPPLITDILISLDDRFLYVSNWLHGDVRQYD 340 (461)
T ss_dssp S---GGGGGG-E-E------EEE-TTS-EEEEEETTTTEEEEEE
T ss_pred cccccccccccc-CCCceEeEEEccCCCEEEEEcccCCcEEEEe
Confidence 0000 0125899999999999876654 56555543
No 444
>PF07995 GSDH: Glucose / Sorbosone dehydrogenase; InterPro: IPR012938 Proteins containing this domain are thought to be glucose/sorbosone dehydrogenases. The best characterised of these proteins is soluble glucose dehydrogenase (P13650 from SWISSPROT) from Acinetobacter calcoaceticus, which oxidises glucose to gluconolactone. The enzyme is a calcium-dependent homodimer which uses PQQ as a cofactor [].; GO: 0016901 oxidoreductase activity, acting on the CH-OH group of donors, quinone or similar compound as acceptor, 0048038 quinone binding, 0005975 carbohydrate metabolic process; PDB: 2ISM_A 2WG3_D 3HO5_A 3HO4_A 3HO3_A 2WFT_A 2WG4_B 2WFX_B 1CRU_A 1CQ1_B ....
Probab=90.00 E-value=4.3 Score=37.15 Aligned_cols=46 Identities=20% Similarity=0.377 Sum_probs=31.3
Q ss_pred eEEEEEecCCCEEEEecCCCeEEEEEcCCCee---eEee-------cCCceeEEEcCC
Q 040274 112 VSALAFHPNGHLMATTGKECKIKIWDLRKYEV---LQTL-------TGHAKTLDFSQK 159 (359)
Q Consensus 112 v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~---~~~~-------~~~v~~~~~s~~ 159 (359)
-++|+|.|||.+|++ ...|.|.+++ ..+.. +..+ ......++++|+
T Consensus 4 P~~~a~~pdG~l~v~-e~~G~i~~~~-~~g~~~~~v~~~~~v~~~~~~gllgia~~p~ 59 (331)
T PF07995_consen 4 PRSMAFLPDGRLLVA-ERSGRIWVVD-KDGSLKTPVADLPEVFADGERGLLGIAFHPD 59 (331)
T ss_dssp EEEEEEETTSCEEEE-ETTTEEEEEE-TTTEECEEEEE-TTTBTSTTBSEEEEEE-TT
T ss_pred ceEEEEeCCCcEEEE-eCCceEEEEe-CCCcCcceecccccccccccCCcccceeccc
Confidence 478999999988776 4599999999 33432 2222 123588999995
No 445
>PRK13615 lipoprotein LpqB; Provisional
Probab=89.62 E-value=9.7 Score=37.42 Aligned_cols=96 Identities=6% Similarity=-0.068 Sum_probs=60.3
Q ss_pred EEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecC-CceeEEEcCCC-cEEEEcCCcEEEEcCCCCCccccccccccC
Q 040274 113 SALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTG-HAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRYMGNSM 190 (359)
Q Consensus 113 ~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~-~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~~~~~~ 190 (359)
.+++.++++..++....++.+.++... +.....+.+ .++.-.|+++| +.++..+....+......+... .....-.
T Consensus 337 ~s~avS~dg~~~A~v~~~~~l~vg~~~-~~~~~~~~~~~Lt~PS~d~~g~vWtv~~g~~~~l~~~~~~G~~~-~v~v~~~ 414 (557)
T PRK13615 337 DAATLSADGRQAAVRNASGVWSVGDGD-RDAVLLDTRPGLVAPSLDAQGYVWSTPASDPRGLVAWGPDGVGH-PVAVSWT 414 (557)
T ss_pred ccceEcCCCceEEEEcCCceEEEecCC-CcceeeccCCccccCcCcCCCCEEEEeCCCceEEEEecCCCceE-Eeecccc
Confidence 788999999999988888888888665 222223334 37888899999 6665554444544322222221 1111111
Q ss_pred CCCcceeEEEEccCCCEEEEE
Q 040274 191 VKGYQIGKVSFRPYEDVLGIG 211 (359)
Q Consensus 191 ~~~~~v~~~~~sp~~~~l~~g 211 (359)
.+..|..+..|+||-.++.-
T Consensus 415 -~~~~I~~lrvSrDG~R~Avi 434 (557)
T PRK13615 415 -ATGRVVSLEVARDGARVLVQ 434 (557)
T ss_pred -CCCeeEEEEeCCCccEEEEE
Confidence 33479999999999776654
No 446
>TIGR02276 beta_rpt_yvtn 40-residue YVTN family beta-propeller repeat. This repeat of about 40 amino acids is found in up to 14 copies per protein. Archaea Methanosarcina mazei and Methanosarcina acetivorans each have over 10 genes that encode tandem copies of this repeat, which is also found in other species. PSIPRED predicts with high confidence that each 40-residue repeats contains four beta strands. This model overlaps somewhat with the NHL repeat (Pfam pfam01436) and also shows sequence similarity to the WD domain, G-beta repeat (Pfam pfam00400).
Probab=88.96 E-value=2.4 Score=25.06 Aligned_cols=38 Identities=18% Similarity=0.312 Sum_probs=25.8
Q ss_pred cCCCEEEEec-CCCeEEEEEcCCCeeeEeec--CCceeEEE
Q 040274 119 PNGHLMATTG-KECKIKIWDLRKYEVLQTLT--GHAKTLDF 156 (359)
Q Consensus 119 p~g~~l~s~~-~d~~i~vwd~~~~~~~~~~~--~~v~~~~~ 156 (359)
|+++.|+++. .++.|.++|..++..+..+. .....++|
T Consensus 1 pd~~~lyv~~~~~~~v~~id~~~~~~~~~i~vg~~P~~i~~ 41 (42)
T TIGR02276 1 PDGTKLYVTNSGSNTVSVIDTATNKVIATIPVGGYPFGVAV 41 (42)
T ss_pred CCCCEEEEEeCCCCEEEEEECCCCeEEEEEECCCCCceEEe
Confidence 5667655544 57899999998888777762 23455554
No 447
>COG5167 VID27 Protein involved in vacuole import and degradation [Intracellular trafficking and secretion]
Probab=88.86 E-value=5.2 Score=38.12 Aligned_cols=104 Identities=14% Similarity=0.195 Sum_probs=64.0
Q ss_pred EEEEcCCCC-------EEEEEeCCCeEEEEeCCCCc-ceEEeecCCCCeEEEEEec----CCCEEEEecCCCeEEEEEcC
Q 040274 72 LMRVNPFNG-------VVSLGHSGGTVTMWKPTTSA-LLIKMLYHQGPVSALAFHP----NGHLMATTGKECKIKIWDLR 139 (359)
Q Consensus 72 ~l~~sp~~~-------~l~tg~~dg~v~lwd~~~~~-~~~~~~~h~~~v~~l~~~p----~g~~l~s~~~d~~i~vwd~~ 139 (359)
-+.|+|+.. .-+.|-.+..|.-.|++... .+.... ....++--.|+. ...|+|.+|..|.|++||.-
T Consensus 513 vVqy~p~~kf~qmt~eqtlvGlS~~svFrIDPR~~gNKi~v~e-sKdY~tKn~Fss~~tTesGyIa~as~kGDirLyDRi 591 (776)
T COG5167 513 VVQYNPYFKFQQMTDEQTLVGLSDYSVFRIDPRARGNKIKVVE-SKDYKTKNKFSSGMTTESGYIAAASRKGDIRLYDRI 591 (776)
T ss_pred eeecCCchhHHhcCccceEEeecccceEEecccccCCceeeee-ehhccccccccccccccCceEEEecCCCceeeehhh
Confidence 667777653 23456667778777877432 222111 112222222222 34489999999999999964
Q ss_pred C---CeeeEeecCCceeEEEcCCC-cEEEEcCCcEEEEcCC
Q 040274 140 K---YEVLQTLTGHAKTLDFSQKG-LLAVGTGSFAQILGDF 176 (359)
Q Consensus 140 ~---~~~~~~~~~~v~~~~~s~~g-l~~~~~d~~i~v~d~~ 176 (359)
. ...+..+...|-.+..+.+| .+.+.....+.+.|+.
T Consensus 592 g~rAKtalP~lG~aIk~idvta~Gk~ilaTCk~yllL~d~~ 632 (776)
T COG5167 592 GKRAKTALPGLGDAIKHIDVTANGKHILATCKNYLLLTDVP 632 (776)
T ss_pred cchhhhcCcccccceeeeEeecCCcEEEEeecceEEEEecc
Confidence 3 23344445668888999999 6666666778887754
No 448
>TIGR03074 PQQ_membr_DH membrane-bound PQQ-dependent dehydrogenase, glucose/quinate/shikimate family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Members of this family have several predicted transmembrane helices in the N-terminal region, and include the quinoprotein glucose dehydrogenase (EC 1.1.5.2) of Escherichia coli and the quinate/shikimate dehydrogenase of Acinetobacter sp. ADP1 (EC 1.1.99.25). Sequences closely related except for the absense of the N-terminal hydrophobic region, scoring in the gray zone between the trusted and noise cutoffs, include PQQ-dependent glycerol (EC 1.1.99.22) and and other polyol (sugar alcohol) dehydrogenases.
Probab=88.83 E-value=13 Score=38.16 Aligned_cols=69 Identities=7% Similarity=0.039 Sum_probs=50.5
Q ss_pred CCEEEEEeCCCeEEEEeCCCCcceEEeecCCCC--------eEEEEEec----------------CCCEEEEecCCCeEE
Q 040274 79 NGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGP--------VSALAFHP----------------NGHLMATTGKECKIK 134 (359)
Q Consensus 79 ~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~--------v~~l~~~p----------------~g~~l~s~~~d~~i~ 134 (359)
+..|+.++.++.|.-.|..||+.+..+...... ...+++.. ++..++.++.|+.|.
T Consensus 194 gg~lYv~t~~~~V~ALDa~TGk~lW~~d~~~~~~~~~~~~~cRGvay~~~p~~~~~~~~~~~p~~~~~rV~~~T~Dg~Li 273 (764)
T TIGR03074 194 GDTLYLCTPHNKVIALDAATGKEKWKFDPKLKTEAGRQHQTCRGVSYYDAPAAAAGPAAPAAPADCARRIILPTSDARLI 273 (764)
T ss_pred CCEEEEECCCCeEEEEECCCCcEEEEEcCCCCcccccccccccceEEecCCcccccccccccccccCCEEEEecCCCeEE
Confidence 567888888899999999999988877643211 12233321 234788888999999
Q ss_pred EEEcCCCeeeEee
Q 040274 135 IWDLRKYEVLQTL 147 (359)
Q Consensus 135 vwd~~~~~~~~~~ 147 (359)
-.|..+|+.+..+
T Consensus 274 ALDA~TGk~~W~f 286 (764)
T TIGR03074 274 ALDADTGKLCEDF 286 (764)
T ss_pred EEECCCCCEEEEe
Confidence 9999999988766
No 449
>PF14269 Arylsulfotran_2: Arylsulfotransferase (ASST)
Probab=88.50 E-value=5.5 Score=35.87 Aligned_cols=71 Identities=7% Similarity=0.186 Sum_probs=52.8
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCe-----EEEEEecCCCEEEEecCCCeEEEEEcC
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPV-----SALAFHPNGHLMATTGKECKIKIWDLR 139 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v-----~~l~~~p~g~~l~s~~~d~~i~vwd~~ 139 (359)
.++++...++|.+|++.-.-.+|.+.|..+++.+..+.+....- ...+|-.+-+++-.+..+++|.++|=.
T Consensus 145 HiNsV~~~~~G~yLiS~R~~~~i~~I~~~tG~I~W~lgG~~~~df~~~~~~f~~QHdar~~~~~~~~~~IslFDN~ 220 (299)
T PF14269_consen 145 HINSVDKDDDGDYLISSRNTSTIYKIDPSTGKIIWRLGGKRNSDFTLPATNFSWQHDARFLNESNDDGTISLFDNA 220 (299)
T ss_pred EeeeeeecCCccEEEEecccCEEEEEECCCCcEEEEeCCCCCCcccccCCcEeeccCCEEeccCCCCCEEEEEcCC
Confidence 78899888899999999888899999999999988886652211 123444455555566778889999863
No 450
>KOG1916 consensus Nuclear protein, contains WD40 repeats [General function prediction only]
Probab=88.36 E-value=0.43 Score=48.02 Aligned_cols=66 Identities=14% Similarity=0.253 Sum_probs=42.8
Q ss_pred EEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEE-----------EecCCCEEEEecCCCeEEEEEc
Q 040274 72 LMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALA-----------FHPNGHLMATTGKECKIKIWDL 138 (359)
Q Consensus 72 ~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~-----------~~p~g~~l~s~~~d~~i~vwd~ 138 (359)
.+-|-++..++.++..++.|++..+++... ..+.+|...++.++ .+|||..|++++.||.+..|.+
T Consensus 188 wcp~~~~~~~ic~~~~~~~i~lL~~~ra~~-~l~rsHs~~~~d~a~~~~g~~~l~~lSpDGtv~a~a~~dG~v~f~Qi 264 (1283)
T KOG1916|consen 188 WCPIAVNKVYICYGLKGGEIRLLNINRALR-SLFRSHSQRVTDMAFFAEGVLKLASLSPDGTVFAWAISDGSVGFYQI 264 (1283)
T ss_pred ecccccccceeeeccCCCceeEeeechHHH-HHHHhcCCCcccHHHHhhchhhheeeCCCCcEEEEeecCCccceeee
Confidence 333444566788888889998877765422 33445665554433 5677777777777777777754
No 451
>KOG1900 consensus Nuclear pore complex, Nup155 component (D Nup154, sc Nup157/Nup170) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=88.34 E-value=16 Score=39.03 Aligned_cols=147 Identities=9% Similarity=0.063 Sum_probs=84.9
Q ss_pred eCCCeEEEEeCCCCcceEEeecCCCCeEEEEE--------ecCCCEEEEecCCCeEEEEEcC----CCee---e--Eee-
Q 040274 86 HSGGTVTMWKPTTSALLIKMLYHQGPVSALAF--------HPNGHLMATTGKECKIKIWDLR----KYEV---L--QTL- 147 (359)
Q Consensus 86 ~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~--------~p~g~~l~s~~~d~~i~vwd~~----~~~~---~--~~~- 147 (359)
+.|..+.+|+.+++.....+.+-...|..+.. .|.=.+++..+.--.|.++-+. ++.. . .++
T Consensus 96 TiDn~L~lWny~~~~e~~~~d~~shtIl~V~LvkPkpgvFv~~IqhlLvvaT~~ei~ilgV~~~~~~~~~~~f~~~~~i~ 175 (1311)
T KOG1900|consen 96 TIDNNLFLWNYESDNELAEYDGLSHTILKVGLVKPKPGVFVPEIQHLLVVATPVEIVILGVSFDEFTGELSIFNTSFKIS 175 (1311)
T ss_pred EeCCeEEEEEcCCCCccccccchhhhheeeeeecCCCCcchhhhheeEEecccceEEEEEEEeccccCcccccccceeee
Confidence 45789999999987666666655555555543 2233344444444445555332 1111 1 111
Q ss_pred --cCCceeEEEcCCC-cEEEEcCCcEE--EEcCCCC---C-------------ccccccccccCCCCcceeEEEEccCCC
Q 040274 148 --TGHAKTLDFSQKG-LLAVGTGSFAQ--ILGDFSG---S-------------HNYSRYMGNSMVKGYQIGKVSFRPYED 206 (359)
Q Consensus 148 --~~~v~~~~~s~~g-l~~~~~d~~i~--v~d~~~~---~-------------~~~~~~~~~~~~~~~~v~~~~~sp~~~ 206 (359)
...|+|+....+| ++.+|.||.|+ +|....+ . ..+..+....+.+..+|..+.....-.
T Consensus 176 ~dg~~V~~I~~t~nGRIF~~G~dg~lyEl~Yq~~~gWf~~rc~Kiclt~s~ls~lvPs~~~~~~~~~dpI~qi~ID~SR~ 255 (1311)
T KOG1900|consen 176 VDGVSVNCITYTENGRIFFAGRDGNLYELVYQAEDGWFGSRCRKICLTKSVLSSLVPSLLSVPGSSKDPIRQITIDNSRN 255 (1311)
T ss_pred cCCceEEEEEeccCCcEEEeecCCCEEEEEEeccCchhhcccccccCchhHHHHhhhhhhcCCCCCCCcceeeEeccccc
Confidence 2347888888899 77777777443 2221111 0 000111111111345789999988888
Q ss_pred EEEEEeCCCeEEEEEcCC-CCCceeee
Q 040274 207 VLGIGHSMGWSGILVPRS-SEPNFDSW 232 (359)
Q Consensus 207 ~l~~g~~dg~~~i~~~gs-~~~~~~~~ 232 (359)
+|.+-+..|.+++|+.+. |.+..+..
T Consensus 256 IlY~lsek~~v~~Y~i~~~G~~~~r~~ 282 (1311)
T KOG1900|consen 256 ILYVLSEKGTVSAYDIGGNGLGGPRFV 282 (1311)
T ss_pred eeeeeccCceEEEEEccCCCccceeee
Confidence 999999999999998876 54444444
No 452
>PHA02790 Kelch-like protein; Provisional
Probab=88.23 E-value=9.8 Score=36.83 Aligned_cols=98 Identities=12% Similarity=0.032 Sum_probs=50.0
Q ss_pred CCCEEEEEeCCC-----eEEEEeCCCCcceE--EeecCCCCeEEEEEecCCCEEEEecCC--CeEEEEEcCCCee--eEe
Q 040274 78 FNGVVSLGHSGG-----TVTMWKPTTSALLI--KMLYHQGPVSALAFHPNGHLMATTGKE--CKIKIWDLRKYEV--LQT 146 (359)
Q Consensus 78 ~~~~l~tg~~dg-----~v~lwd~~~~~~~~--~~~~h~~~v~~l~~~p~g~~l~s~~~d--~~i~vwd~~~~~~--~~~ 146 (359)
++.++++|+.++ ++..||+.+..... .+.........+ .-+|.+.+.||.+ ..+..||..++.- +..
T Consensus 271 ~~~lyviGG~~~~~~~~~v~~Ydp~~~~W~~~~~m~~~r~~~~~v--~~~~~iYviGG~~~~~sve~ydp~~n~W~~~~~ 348 (480)
T PHA02790 271 GEVVYLIGGWMNNEIHNNAIAVNYISNNWIPIPPMNSPRLYASGV--PANNKLYVVGGLPNPTSVERWFHGDAAWVNMPS 348 (480)
T ss_pred CCEEEEEcCCCCCCcCCeEEEEECCCCEEEECCCCCchhhcceEE--EECCEEEEECCcCCCCceEEEECCCCeEEECCC
Confidence 345667777543 57788988764322 121111111222 2367777777754 3578888765432 222
Q ss_pred ecCCc--eeEEEcCCC--cEEEEcC---CcEEEEcCCCC
Q 040274 147 LTGHA--KTLDFSQKG--LLAVGTG---SFAQILGDFSG 178 (359)
Q Consensus 147 ~~~~v--~~~~~s~~g--l~~~~~d---~~i~v~d~~~~ 178 (359)
++.+. .+++ .-+| ++.||.+ ..+..||..+.
T Consensus 349 l~~~r~~~~~~-~~~g~IYviGG~~~~~~~ve~ydp~~~ 386 (480)
T PHA02790 349 LLKPRCNPAVA-SINNVIYVIGGHSETDTTTEYLLPNHD 386 (480)
T ss_pred CCCCCcccEEE-EECCEEEEecCcCCCCccEEEEeCCCC
Confidence 22121 1222 2245 5555544 35778886544
No 453
>PHA03098 kelch-like protein; Provisional
Probab=88.06 E-value=9.3 Score=37.49 Aligned_cols=98 Identities=10% Similarity=0.061 Sum_probs=48.9
Q ss_pred CCCEEEEEeCCC------eEEEEeCCCCcceEE--eecCCCCeEEEEEecCCCEEEEecCC-----CeEEEEEcCCCeee
Q 040274 78 FNGVVSLGHSGG------TVTMWKPTTSALLIK--MLYHQGPVSALAFHPNGHLMATTGKE-----CKIKIWDLRKYEVL 144 (359)
Q Consensus 78 ~~~~l~tg~~dg------~v~lwd~~~~~~~~~--~~~h~~~v~~l~~~p~g~~l~s~~~d-----~~i~vwd~~~~~~~ 144 (359)
++.+++.|+.++ .+..||+.+.+.... +.........+ .-++.+++.||.+ ..+..||..+.+-.
T Consensus 294 ~~~lyv~GG~~~~~~~~~~v~~yd~~~~~W~~~~~~~~~R~~~~~~--~~~~~lyv~GG~~~~~~~~~v~~yd~~~~~W~ 371 (534)
T PHA03098 294 NNVIYFIGGMNKNNLSVNSVVSYDTKTKSWNKVPELIYPRKNPGVT--VFNNRIYVIGGIYNSISLNTVESWKPGESKWR 371 (534)
T ss_pred CCEEEEECCCcCCCCeeccEEEEeCCCCeeeECCCCCcccccceEE--EECCEEEEEeCCCCCEecceEEEEcCCCCcee
Confidence 445666676542 577888877654221 11111111222 2356777778765 34778888765422
Q ss_pred --EeecCCc--eeEEEcCCC--cEEEEcC------CcEEEEcCCCC
Q 040274 145 --QTLTGHA--KTLDFSQKG--LLAVGTG------SFAQILGDFSG 178 (359)
Q Consensus 145 --~~~~~~v--~~~~~s~~g--l~~~~~d------~~i~v~d~~~~ 178 (359)
..++.+. .+++.. ++ ++.||.+ +.+..||+.+.
T Consensus 372 ~~~~lp~~r~~~~~~~~-~~~iYv~GG~~~~~~~~~~v~~yd~~t~ 416 (534)
T PHA03098 372 EEPPLIFPRYNPCVVNV-NNLIYVIGGISKNDELLKTVECFSLNTN 416 (534)
T ss_pred eCCCcCcCCccceEEEE-CCEEEEECCcCCCCcccceEEEEeCCCC
Confidence 1121111 122222 34 5555532 45788886544
No 454
>KOG2247 consensus WD40 repeat-containing protein [General function prediction only]
Probab=88.04 E-value=0.071 Score=49.81 Aligned_cols=118 Identities=13% Similarity=0.123 Sum_probs=76.5
Q ss_pred hccceEEEECCCCCEEEEecc---------------------ceeEEEEcCCCCE-EEEEeCCCeEEEEeCCCCcceEEe
Q 040274 48 NLVHILWILPSSGRYMAVAGR---------------------RTDLMRVNPFNGV-VSLGHSGGTVTMWKPTTSALLIKM 105 (359)
Q Consensus 48 ll~~~~l~~spdg~~l~~~~~---------------------~v~~l~~sp~~~~-l~tg~~dg~v~lwd~~~~~~~~~~ 105 (359)
+.......|.|.+..++.++. ....|+|.-++.. ++.+...+.+.+||+++......-
T Consensus 34 lv~pi~~~w~~e~~nlavaca~tiv~~YD~agq~~le~n~tg~aldm~wDkegdvlavlAek~~piylwd~n~eytqqLE 113 (615)
T KOG2247|consen 34 LVGPIIHRWRPEGHNLAVACANTIVIYYDKAGQVILELNPTGKALDMAWDKEGDVLAVLAEKTGPIYLWDVNSEYTQQLE 113 (615)
T ss_pred ccccceeeEecCCCceehhhhhhHHHhhhhhcceecccCCchhHhhhhhccccchhhhhhhcCCCeeechhhhhhHHHHh
Confidence 333467777776666666554 5677888887664 455677899999999864321111
Q ss_pred ecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee---cCCceeEEEcCCC-cEEEE
Q 040274 106 LYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL---TGHAKTLDFSQKG-LLAVG 165 (359)
Q Consensus 106 ~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~---~~~v~~~~~s~~g-l~~~~ 165 (359)
.+....-.-+.|++.+..++.+...|++.+++..+...+... ...+++++|.+.+ .+.++
T Consensus 114 ~gg~~s~sll~wsKg~~el~ig~~~gn~viynhgtsR~iiv~Gkh~RRgtq~av~lEd~vil~d 177 (615)
T KOG2247|consen 114 SGGTSSKSLLAWSKGTPELVIGNNAGNIVIYNHGTSRRIIVMGKHQRRGTQIAVTLEDYVILCD 177 (615)
T ss_pred ccCcchHHHHhhccCCccccccccccceEEEeccchhhhhhhcccccceeEEEecccceeeecC
Confidence 122222223788998888999989999999998765443332 2346778888777 33333
No 455
>PF08728 CRT10: CRT10; InterPro: IPR014839 CRT10 is a transcriptional regulator of ribonucleotide reductase (RNR) genes []. RNR catalyses the rate limiting step in dNTP synthesis. Mutations in CRT10 have been shown to enhance hydroxyurea resistance [].
Probab=88.03 E-value=9.4 Score=38.43 Aligned_cols=106 Identities=12% Similarity=0.197 Sum_probs=68.7
Q ss_pred ceeEEEEcC--CCCEEEEEeCCCeEEEEeCCC-------C-------------cceEEeecCCCCeEEEEEe--cCCCEE
Q 040274 69 RTDLMRVNP--FNGVVSLGHSGGTVTMWKPTT-------S-------------ALLIKMLYHQGPVSALAFH--PNGHLM 124 (359)
Q Consensus 69 ~v~~l~~sp--~~~~l~tg~~dg~v~lwd~~~-------~-------------~~~~~~~~h~~~v~~l~~~--p~g~~l 124 (359)
.|+.|.... ...+|+.|..||.|.+|.+.+ . +|-..+. -...+++++++ ...+++
T Consensus 102 tIN~i~v~~lg~~EVLl~c~DdG~V~~Yyt~~I~~~i~~~~~~~~~~~~r~~i~P~f~~~-v~~SaWGLdIh~~~~~rlI 180 (717)
T PF08728_consen 102 TINFIKVGDLGGEEVLLLCTDDGDVLAYYTETIIEAIERFSEDNDSGFSRLKIKPFFHLR-VGASAWGLDIHDYKKSRLI 180 (717)
T ss_pred eeeEEEecccCCeeEEEEEecCCeEEEEEHHHHHHHHHhhccccccccccccCCCCeEee-cCCceeEEEEEecCcceEE
Confidence 466666655 335788999999999996521 0 1122222 23468999998 788889
Q ss_pred EEecCCCeEEEEEcCCC--ee--e--EeecCCceeEEEcCC-----C---cEEEEcCCcEEEEcC
Q 040274 125 ATTGKECKIKIWDLRKY--EV--L--QTLTGHAKTLDFSQK-----G---LLAVGTGSFAQILGD 175 (359)
Q Consensus 125 ~s~~~d~~i~vwd~~~~--~~--~--~~~~~~v~~~~~s~~-----g---l~~~~~d~~i~v~d~ 175 (359)
|.++....|.||-+... +. . ......|.+|+|-++ | +++++-.|.+.+|++
T Consensus 181 AVSsNs~~VTVFaf~l~~~r~~~~~s~~~~hNIP~VSFl~~~~d~~G~v~v~a~dI~G~v~~~~I 245 (717)
T PF08728_consen 181 AVSSNSQEVTVFAFALVDERFYHVPSHQHSHNIPNVSFLDDDLDPNGHVKVVATDISGEVWTFKI 245 (717)
T ss_pred EEecCCceEEEEEEeccccccccccccccccCCCeeEeecCCCCCccceEEEEEeccCcEEEEEE
Confidence 99988888888755431 11 1 112334788888653 3 445666798888875
No 456
>PF14781 BBS2_N: Ciliary BBSome complex subunit 2, N-terminal
Probab=87.98 E-value=11 Score=29.31 Aligned_cols=64 Identities=14% Similarity=0.056 Sum_probs=42.8
Q ss_pred EEEecCCCEEEEecCCCeEEEEEcCCC--------eeeEee--cCCceeEEEcC---CC---cEEEEcCCcEEEEcCCCC
Q 040274 115 LAFHPNGHLMATTGKECKIKIWDLRKY--------EVLQTL--TGHAKTLDFSQ---KG---LLAVGTGSFAQILGDFSG 178 (359)
Q Consensus 115 l~~~p~g~~l~s~~~d~~i~vwd~~~~--------~~~~~~--~~~v~~~~~s~---~g---l~~~~~d~~i~v~d~~~~ 178 (359)
-.|......|++++.-|.|.|++.... ..+..+ ...|++++-.+ +. ++..++..++..||+...
T Consensus 4 GkfDG~~pcL~~aT~~gKV~IH~ph~~~~~~~~~~~~i~~LNin~~italaaG~l~~~~~~D~LliGt~t~llaYDV~~N 83 (136)
T PF14781_consen 4 GKFDGVHPCLACATTGGKVFIHNPHERGQRTGRQDSDISFLNINQEITALAAGRLKPDDGRDCLLIGTQTSLLAYDVENN 83 (136)
T ss_pred EEeCCCceeEEEEecCCEEEEECCCccccccccccCceeEEECCCceEEEEEEecCCCCCcCEEEEeccceEEEEEcccC
Confidence 455555667888888899999986532 223333 45566665433 32 777788889999998665
No 457
>KOG3616 consensus Selective LIM binding factor [Transcription]
Probab=87.98 E-value=1.4 Score=43.75 Aligned_cols=66 Identities=15% Similarity=0.228 Sum_probs=52.1
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCee--eEeecCCceeEEEcCCCcEEEEcCCcEEEEc
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEV--LQTLTGHAKTLDFSQKGLLAVGTGSFAQILG 174 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~--~~~~~~~v~~~~~s~~gl~~~~~d~~i~v~d 174 (359)
...++++.-+|.|..++++..||.|.+|+...... +.+...+...+.|...|+++..+|..+.-|.
T Consensus 14 ~e~~~aiqshp~~~s~v~~~~d~si~lfn~~~r~qski~~~~~p~~nlv~tnhgl~~~tsdrr~la~~ 81 (1636)
T KOG3616|consen 14 DEFTTAIQSHPGGQSFVLAHQDGSIILFNFIPRRQSKICEEAKPKENLVFTNHGLVTATSDRRALAWK 81 (1636)
T ss_pred cceeeeeeecCCCceEEEEecCCcEEEEeecccchhhhhhhcCCccceeeeccceEEEeccchhheee
Confidence 34567888889999999999999999998765433 4444556678889888988888888877775
No 458
>COG5290 IkappaB kinase complex, IKAP component [Transcription]
Probab=87.88 E-value=2 Score=42.98 Aligned_cols=103 Identities=18% Similarity=0.218 Sum_probs=60.1
Q ss_pred eEEEEEecCCCEEEEecCCCe-----EEEEEcC---CCeeeEee--cCCceeEEEcCCC-cEEEEcCCcEEEEcCCCCCc
Q 040274 112 VSALAFHPNGHLMATTGKECK-----IKIWDLR---KYEVLQTL--TGHAKTLDFSQKG-LLAVGTGSFAQILGDFSGSH 180 (359)
Q Consensus 112 v~~l~~~p~g~~l~s~~~d~~-----i~vwd~~---~~~~~~~~--~~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~ 180 (359)
-+-++|-|+|..++|-+.||. |.++..+ -|+.-... ...+..++|+-.. .++.+..+.|.+|-..+
T Consensus 249 e~~LSWkpqgS~~ati~td~~~~S~~ViFfErNGLrHGef~lr~~~dEk~~~~~wn~~s~vlav~~~n~~~lwttkN--- 325 (1243)
T COG5290 249 EHQLSWKPQGSKYATIGTDGCSTSESVIFFERNGLRHGEFDLRVGCDEKAFLENWNLLSTVLAVAEGNLLKLWTTKN--- 325 (1243)
T ss_pred hhccccccCCceeeeeccCCCCCcceEEEEccCCcccCCccccCCchhhhhhhhhhHHHHHHHHhhcceEEEEEccc---
Confidence 345899999999999886652 4444432 22221111 2345778887777 77888889999996422
Q ss_pred cccccccccCCCCcceeEEEEccCCCE-EEEEeCCCeEEE
Q 040274 181 NYSRYMGNSMVKGYQIGKVSFRPYEDV-LGIGHSMGWSGI 219 (359)
Q Consensus 181 ~~~~~~~~~~~~~~~v~~~~~sp~~~~-l~~g~~dg~~~i 219 (359)
..-|..... .-..+.-+.|+|.... |+....+.+..+
T Consensus 326 -yhWYLK~e~-~ip~~s~vkwhpe~~nTl~f~d~~~I~~V 363 (1243)
T COG5290 326 -YHWYLKVER-QIPGISYVKWHPEEKNTLLFRDGERILRV 363 (1243)
T ss_pred -eEEEEEEee-cCCCcceeeeccccCcEEEEecCCeEEEE
Confidence 222222211 1124677899997644 444333433344
No 459
>TIGR03075 PQQ_enz_alc_DH PQQ-dependent dehydrogenase, methanol/ethanol family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Genes in this family often are found adjacent to the PQQ biosynthesis genes themselves. An unusual, strained disulfide bond between adjacent Cys residues contributes to PQQ-binding, as does a Trp residue that is part of a PQQ enzyme repeat (see pfam01011). Characterized members include the dehydrogenase subunit of a membrane-anchored, three subunit alcohol (ethanol) dehydrogenase of Gluconobacter suboxydans, a homodimeric ethanol dehydrogenase in Pseudomonas aeruginosa, and the large subunit of an alpha2/beta2 heterotetrameric methanol dehydrogenase in Methylobacterium extorquens.
Probab=87.62 E-value=20 Score=35.16 Aligned_cols=98 Identities=15% Similarity=0.111 Sum_probs=61.3
Q ss_pred CCEEEEEeCCCeEEEEeCCCCcceEEeecCC-CCeE----------EEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee
Q 040274 79 NGVVSLGHSGGTVTMWKPTTSALLIKMLYHQ-GPVS----------ALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL 147 (359)
Q Consensus 79 ~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~-~~v~----------~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~ 147 (359)
+..|++++.++.|.-.|..+|+.+..+.... ..+. .+++ .+..++.++.|+.|.-.|..+|+.+...
T Consensus 69 ~g~vyv~s~~g~v~AlDa~TGk~lW~~~~~~~~~~~~~~~~~~~~rg~av--~~~~v~v~t~dg~l~ALDa~TGk~~W~~ 146 (527)
T TIGR03075 69 DGVMYVTTSYSRVYALDAKTGKELWKYDPKLPDDVIPVMCCDVVNRGVAL--YDGKVFFGTLDARLVALDAKTGKVVWSK 146 (527)
T ss_pred CCEEEEECCCCcEEEEECCCCceeeEecCCCCcccccccccccccccceE--ECCEEEEEcCCCEEEEEECCCCCEEeec
Confidence 5577778888899999999999888765321 1111 1122 2346777888999999999999988766
Q ss_pred cC--Cc--eeEEEcC---CC-cEEEEc------CCcEEEEcCCCC
Q 040274 148 TG--HA--KTLDFSQ---KG-LLAVGT------GSFAQILGDFSG 178 (359)
Q Consensus 148 ~~--~v--~~~~~s~---~g-l~~~~~------d~~i~v~d~~~~ 178 (359)
.. .. ..+.-+| ++ ++.++. +|.|..+|..++
T Consensus 147 ~~~~~~~~~~~tssP~v~~g~Vivg~~~~~~~~~G~v~AlD~~TG 191 (527)
T TIGR03075 147 KNGDYKAGYTITAAPLVVKGKVITGISGGEFGVRGYVTAYDAKTG 191 (527)
T ss_pred ccccccccccccCCcEEECCEEEEeecccccCCCcEEEEEECCCC
Confidence 21 10 1111122 34 444332 577888886555
No 460
>TIGR03606 non_repeat_PQQ dehydrogenase, PQQ-dependent, s-GDH family. PQQ, or pyrroloquinoline-quinone, serves as a cofactor for a number of sugar and alcohol dehydrogenases in a limited number of bacterial species. Most characterized PQQ-dependent enzymes have multiple repeats of a sequence region described by pfam01011 (PQQ enzyme repeat), but this protein family in unusual in lacking that repeat. Below the noise cutoff are related proteins mostly from species that lack PQQ biosynthesis.
Probab=87.38 E-value=22 Score=33.98 Aligned_cols=51 Identities=24% Similarity=0.154 Sum_probs=35.4
Q ss_pred CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCe--eeEee--------cCCceeEEEcCC
Q 040274 109 QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYE--VLQTL--------TGHAKTLDFSQK 159 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~--~~~~~--------~~~v~~~~~s~~ 159 (359)
-..-+.|+|.|||++|++--..|.|++++..++. .+..+ .+....|+++|+
T Consensus 29 L~~Pw~maflPDG~llVtER~~G~I~~v~~~~~~~~~~~~l~~v~~~~ge~GLlglal~Pd 89 (454)
T TIGR03606 29 LNKPWALLWGPDNQLWVTERATGKILRVNPETGEVKVVFTLPEIVNDAQHNGLLGLALHPD 89 (454)
T ss_pred CCCceEEEEcCCCeEEEEEecCCEEEEEeCCCCceeeeecCCceeccCCCCceeeEEECCC
Confidence 4456889999999888776557999999865442 22222 234678999887
No 461
>KOG2280 consensus Vacuolar assembly/sorting protein VPS16 [Intracellular trafficking, secretion, and vesicular transport]
Probab=87.17 E-value=8.8 Score=38.35 Aligned_cols=79 Identities=14% Similarity=0.154 Sum_probs=48.6
Q ss_pred CCeEEEEEcCCCeeeEee---cCCceeEEEcCCC-cEEEEcCCcEEEEcCCCCCcccccc-ccccCCCCcceeEEEEccC
Q 040274 130 ECKIKIWDLRKYEVLQTL---TGHAKTLDFSQKG-LLAVGTGSFAQILGDFSGSHNYSRY-MGNSMVKGYQIGKVSFRPY 204 (359)
Q Consensus 130 d~~i~vwd~~~~~~~~~~---~~~v~~~~~s~~g-l~~~~~d~~i~v~d~~~~~~~~~~~-~~~~~~~~~~v~~~~~sp~ 204 (359)
-..|+||++. |..+..+ .+.+-.+.|+.+. +++...+|+++||++... ....+ .+... ....|..+.|..+
T Consensus 63 ~~~I~If~~s-G~lL~~~~w~~~~lI~mgWs~~eeLI~v~k~g~v~Vy~~~ge--~ie~~svg~e~-~~~~I~ec~~f~~ 138 (829)
T KOG2280|consen 63 RPYIRIFNIS-GQLLGRILWKHGELIGMGWSDDEELICVQKDGTVHVYGLLGE--FIESNSVGFES-QMSDIVECRFFHN 138 (829)
T ss_pred ceeEEEEecc-ccchHHHHhcCCCeeeecccCCceEEEEeccceEEEeecchh--hhccccccccc-ccCceeEEEEecC
Confidence 3457788764 6665555 4578899999999 999999999999996432 22221 11111 2224555555555
Q ss_pred CCEEEEEe
Q 040274 205 EDVLGIGH 212 (359)
Q Consensus 205 ~~~l~~g~ 212 (359)
|-.+++.+
T Consensus 139 GVavlt~~ 146 (829)
T KOG2280|consen 139 GVAVLTVS 146 (829)
T ss_pred ceEEEecC
Confidence 54444433
No 462
>TIGR03032 conserved hypothetical protein TIGR03032. This protein family is uncharacterized. A number of motifs are conserved perfectly among all member sequences. The function of this protein is unknown.
Probab=87.11 E-value=10 Score=34.03 Aligned_cols=65 Identities=18% Similarity=0.157 Sum_probs=39.8
Q ss_pred CCCEEEEeccceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEe
Q 040274 59 SGRYMAVAGRRTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATT 127 (359)
Q Consensus 59 dg~~l~~~~~~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~ 127 (359)
+++.++.|-....+..|+ +|++.++-+..|.|..+|.++|........ .+...+++|. |.+++++
T Consensus 194 s~evl~~GLsmPhSPRWh-dgrLwvldsgtGev~~vD~~~G~~e~Va~v-pG~~rGL~f~--G~llvVg 258 (335)
T TIGR03032 194 SGEVVASGLSMPHSPRWY-QGKLWLLNSGRGELGYVDPQAGKFQPVAFL-PGFTRGLAFA--GDFAFVG 258 (335)
T ss_pred CCCEEEcCccCCcCCcEe-CCeEEEEECCCCEEEEEcCCCCcEEEEEEC-CCCCccccee--CCEEEEE
Confidence 334444443334444444 466667777788999999887754443322 4566788887 7777665
No 463
>PRK13615 lipoprotein LpqB; Provisional
Probab=86.47 E-value=17 Score=35.74 Aligned_cols=136 Identities=10% Similarity=0.040 Sum_probs=77.3
Q ss_pred eEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcC-CCeeeEe-e-
Q 040274 71 DLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLR-KYEVLQT-L- 147 (359)
Q Consensus 71 ~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~-~~~~~~~-~- 147 (359)
.+++.++++..++....++.+.++.... .....+ ....++..+|.++| .+-+...+....+.... ++..... .
T Consensus 337 ~s~avS~dg~~~A~v~~~~~l~vg~~~~-~~~~~~--~~~~Lt~PS~d~~g-~vWtv~~g~~~~l~~~~~~G~~~~v~v~ 412 (557)
T PRK13615 337 DAATLSADGRQAAVRNASGVWSVGDGDR-DAVLLD--TRPGLVAPSLDAQG-YVWSTPASDPRGLVAWGPDGVGHPVAVS 412 (557)
T ss_pred ccceEcCCCceEEEEcCCceEEEecCCC-cceeec--cCCccccCcCcCCC-CEEEEeCCCceEEEEecCCCceEEeecc
Confidence 6778999999988887788888876552 222222 13346777888887 55554443334444432 2333211 1
Q ss_pred ---cCCceeEEEcCCC--cEEEE---cCCcEEEEcCCCCCc---cc--cccccccCCCCcceeEEEEccCCCEEEEEe
Q 040274 148 ---TGHAKTLDFSQKG--LLAVG---TGSFAQILGDFSGSH---NY--SRYMGNSMVKGYQIGKVSFRPYEDVLGIGH 212 (359)
Q Consensus 148 ---~~~v~~~~~s~~g--l~~~~---~d~~i~v~d~~~~~~---~~--~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~ 212 (359)
.+.|+.+..|+|| ++... ..+.|+|--+...+. .+ ....--.. .+ .+.++.|..++.+.+.+.
T Consensus 413 ~~~~~~I~~lrvSrDG~R~Avi~~~~g~~~V~va~V~R~~~~P~~L~~~p~~l~~~-l~-~v~sl~W~~~~~laVl~~ 488 (557)
T PRK13615 413 WTATGRVVSLEVARDGARVLVQLETGAGPQLLVASIVRDGGVPTSLTTTPLELLAS-PG-TPLDATWVDELDVATLTL 488 (557)
T ss_pred ccCCCeeEEEEeCCCccEEEEEEecCCCCEEEEEEEEeCCCcceEeeeccEEcccC-cC-cceeeEEcCCCEEEEEec
Confidence 3569999999999 22222 235566543332212 11 11111001 22 689999999998877663
No 464
>KOG1916 consensus Nuclear protein, contains WD40 repeats [General function prediction only]
Probab=86.38 E-value=0.93 Score=45.80 Aligned_cols=70 Identities=23% Similarity=0.270 Sum_probs=45.0
Q ss_pred EcCCCCEEEEEeCCCeEEEEeCC-CC----cceEEeecCC-CCeEEEEEecCC---------CEEEEec-CCCeEEEEEc
Q 040274 75 VNPFNGVVSLGHSGGTVTMWKPT-TS----ALLIKMLYHQ-GPVSALAFHPNG---------HLMATTG-KECKIKIWDL 138 (359)
Q Consensus 75 ~sp~~~~l~tg~~dg~v~lwd~~-~~----~~~~~~~~h~-~~v~~l~~~p~g---------~~l~s~~-~d~~i~vwd~ 138 (359)
.||||..|++++.||.|..|.+. +| .++.....|. .+-.|.-|+.+. .++++++ ...-+++|.-
T Consensus 243 lSpDGtv~a~a~~dG~v~f~Qiyi~g~~~~rclhewkphd~~p~vC~lc~~~~~~~v~i~~w~~~Itttd~nre~k~w~~ 322 (1283)
T KOG1916|consen 243 LSPDGTVFAWAISDGSVGFYQIYITGKIVHRCLHEWKPHDKHPRVCWLCHKQEILVVSIGKWVLRITTTDVNREEKFWAE 322 (1283)
T ss_pred eCCCCcEEEEeecCCccceeeeeeeccccHhhhhccCCCCCCCceeeeeccccccCCccceeEEEEecccCCcceeEeec
Confidence 79999999999999999988764 22 3455555666 333333343321 1344444 3456889988
Q ss_pred CCCeee
Q 040274 139 RKYEVL 144 (359)
Q Consensus 139 ~~~~~~ 144 (359)
...+|+
T Consensus 323 a~w~Cl 328 (1283)
T KOG1916|consen 323 APWQCL 328 (1283)
T ss_pred cchhhh
Confidence 777776
No 465
>PRK13614 lipoprotein LpqB; Provisional
Probab=86.34 E-value=28 Score=34.46 Aligned_cols=130 Identities=12% Similarity=0.103 Sum_probs=71.2
Q ss_pred EeCCCeEEEEeCCCCcceEEeecCCC-CeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEe-ecC-CceeEEEcCCC-
Q 040274 85 GHSGGTVTMWKPTTSALLIKMLYHQG-PVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQT-LTG-HAKTLDFSQKG- 160 (359)
Q Consensus 85 g~~dg~v~lwd~~~~~~~~~~~~h~~-~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~-~~~-~v~~~~~s~~g- 160 (359)
+-.+|.+...+-..-.++.-..+..+ .+.+++.++++..++..+.|+. .+|-...+..... +.+ .++.-.|+++|
T Consensus 317 ~~~~G~l~~~~~~~~~pv~g~~g~~~~~~~s~avS~~g~~~A~~~~~~~-~l~~~~~g~~~~~~~~g~~Lt~PS~d~~g~ 395 (573)
T PRK13614 317 GVSDGELVRYENGQISPLPDIQSVAGLGPASPAESPVSQTVAFLNGSRT-TLYTVSPGQPARALTSGSTLTRPSFSPQDW 395 (573)
T ss_pred EecCCeEEEecCCCcccCCCccCcCcccccceeecCCCceEEEecCCCc-EEEEecCCCcceeeecCCCccCCcccCCCC
Confidence 33466665544333334444444433 6788899999999888877772 3332222333322 333 46888999999
Q ss_pred cEEEEcCC--cEEEEcCCCCCccc----cccccccCCCCcceeEEEEccCCCEEEE-EeCCCe
Q 040274 161 LLAVGTGS--FAQILGDFSGSHNY----SRYMGNSMVKGYQIGKVSFRPYEDVLGI-GHSMGW 216 (359)
Q Consensus 161 l~~~~~d~--~i~v~d~~~~~~~~----~~~~~~~~~~~~~v~~~~~sp~~~~l~~-g~~dg~ 216 (359)
+.++..++ .|..+.....+... ...... ...+..|..+..|+||-.++. .+.+|.
T Consensus 396 vWtv~~g~~~~vv~~~~~g~~~~~~~~~~~v~~~-~l~g~~I~~lrvSrDG~R~Avi~~~~g~ 457 (573)
T PRK13614 396 VWTAGPGGNGRIVAYRPTGVAEGAQAPTVTLTAD-WLAGRTVKELRVSREGVRALVISEQNGK 457 (573)
T ss_pred EEEeeCCCCceEEEEecCCCcccccccceeeccc-ccCCCeeEEEEECCCccEEEEEEEeCCc
Confidence 66655544 55544422111100 011111 112335999999999966554 444554
No 466
>TIGR02276 beta_rpt_yvtn 40-residue YVTN family beta-propeller repeat. This repeat of about 40 amino acids is found in up to 14 copies per protein. Archaea Methanosarcina mazei and Methanosarcina acetivorans each have over 10 genes that encode tandem copies of this repeat, which is also found in other species. PSIPRED predicts with high confidence that each 40-residue repeats contains four beta strands. This model overlaps somewhat with the NHL repeat (Pfam pfam01436) and also shows sequence similarity to the WD domain, G-beta repeat (Pfam pfam00400).
Probab=86.22 E-value=4.4 Score=23.83 Aligned_cols=31 Identities=13% Similarity=0.196 Sum_probs=22.8
Q ss_pred CCCCEEEEEe-CCCeEEEEeCCCCcceEEeec
Q 040274 77 PFNGVVSLGH-SGGTVTMWKPTTSALLIKMLY 107 (359)
Q Consensus 77 p~~~~l~tg~-~dg~v~lwd~~~~~~~~~~~~ 107 (359)
|+++.|+++. .+++|.++|+.++..+..+..
T Consensus 1 pd~~~lyv~~~~~~~v~~id~~~~~~~~~i~v 32 (42)
T TIGR02276 1 PDGTKLYVTNSGSNTVSVIDTATNKVIATIPV 32 (42)
T ss_pred CCCCEEEEEeCCCCEEEEEECCCCeEEEEEEC
Confidence 5666665554 578999999988887777654
No 467
>PRK13614 lipoprotein LpqB; Provisional
Probab=85.00 E-value=27 Score=34.58 Aligned_cols=142 Identities=15% Similarity=0.132 Sum_probs=76.2
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecCCC--eEEEEEcC-CCee--
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGKEC--KIKIWDLR-KYEV-- 143 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~--~i~vwd~~-~~~~-- 143 (359)
.+.+++.++++..++....++. .+|-...+.....+.. ...++.-+|.++| .+-+...+. .|..+.-. ++..
T Consensus 344 ~~~s~avS~~g~~~A~~~~~~~-~l~~~~~g~~~~~~~~-g~~Lt~PS~d~~g-~vWtv~~g~~~~vv~~~~~g~~~~~~ 420 (573)
T PRK13614 344 GPASPAESPVSQTVAFLNGSRT-TLYTVSPGQPARALTS-GSTLTRPSFSPQD-WVWTAGPGGNGRIVAYRPTGVAEGAQ 420 (573)
T ss_pred cccceeecCCCceEEEecCCCc-EEEEecCCCcceeeec-CCCccCCcccCCC-CEEEeeCCCCceEEEEecCCCccccc
Confidence 5677889999998888877762 3343222333322222 3346778888887 555554433 44444321 1111
Q ss_pred --eEe-----ecC-CceeEEEcCCC---cEEEEcCCc--EEEEcCCC--CCccccccccccCCCCcceeEEEEccCCCEE
Q 040274 144 --LQT-----LTG-HAKTLDFSQKG---LLAVGTGSF--AQILGDFS--GSHNYSRYMGNSMVKGYQIGKVSFRPYEDVL 208 (359)
Q Consensus 144 --~~~-----~~~-~v~~~~~s~~g---l~~~~~d~~--i~v~d~~~--~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l 208 (359)
+.. +.+ .|+.+..|+|| .+....+|. |+|--+.. .+................+.++.|..++.++
T Consensus 421 ~~~~~v~~~~l~g~~I~~lrvSrDG~R~Avi~~~~g~~~V~va~V~R~~~G~P~~L~~~~~~~~~~~~~sl~W~~~~sl~ 500 (573)
T PRK13614 421 APTVTLTADWLAGRTVKELRVSREGVRALVISEQNGKSRVQVAGIVRNEDGTPRELTAPITLAADSDADTGAWVGDSTVV 500 (573)
T ss_pred ccceeecccccCCCeeEEEEECCCccEEEEEEEeCCccEEEEEEEEeCCCCCeEEccCceecccCCCcceeEEcCCCEEE
Confidence 111 134 49999999999 333334554 65533222 1121111111110012368999999999877
Q ss_pred EEEeC
Q 040274 209 GIGHS 213 (359)
Q Consensus 209 ~~g~~ 213 (359)
+.+..
T Consensus 501 V~~~~ 505 (573)
T PRK13614 501 VTKAS 505 (573)
T ss_pred EEecc
Confidence 76543
No 468
>COG1520 FOG: WD40-like repeat [Function unknown]
Probab=84.63 E-value=11 Score=34.93 Aligned_cols=98 Identities=13% Similarity=0.129 Sum_probs=59.1
Q ss_pred CEEEEEeCCCeEEEEeCCCCcceEEeecC--CCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecCCc----ee
Q 040274 80 GVVSLGHSGGTVTMWKPTTSALLIKMLYH--QGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTGHA----KT 153 (359)
Q Consensus 80 ~~l~tg~~dg~v~lwd~~~~~~~~~~~~h--~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~~v----~~ 153 (359)
..++++..+|.|.-.|+.++..+.....- ...+.+-.+..+|+ ++.++.++.++.+|..+|+.+..+.... ..
T Consensus 69 g~v~~~~~~G~i~A~d~~~g~~~W~~~~~~~~~~~~~~~~~~~G~-i~~g~~~g~~y~ld~~~G~~~W~~~~~~~~~~~~ 147 (370)
T COG1520 69 GTVYVGTRDGNIFALNPDTGLVKWSYPLLGAVAQLSGPILGSDGK-IYVGSWDGKLYALDASTGTLVWSRNVGGSPYYAS 147 (370)
T ss_pred CeEEEecCCCcEEEEeCCCCcEEecccCcCcceeccCceEEeCCe-EEEecccceEEEEECCCCcEEEEEecCCCeEEec
Confidence 35666678888888898888766543322 12333333333665 7777888899999998898877773222 22
Q ss_pred EEEcCCC-cEEEEcCCcEEEEcCCCC
Q 040274 154 LDFSQKG-LLAVGTGSFAQILGDFSG 178 (359)
Q Consensus 154 ~~~s~~g-l~~~~~d~~i~v~d~~~~ 178 (359)
.....++ ++.++.++.+...|..++
T Consensus 148 ~~v~~~~~v~~~s~~g~~~al~~~tG 173 (370)
T COG1520 148 PPVVGDGTVYVGTDDGHLYALNADTG 173 (370)
T ss_pred CcEEcCcEEEEecCCCeEEEEEccCC
Confidence 2223344 333335676666664333
No 469
>KOG2247 consensus WD40 repeat-containing protein [General function prediction only]
Probab=84.38 E-value=0.15 Score=47.77 Aligned_cols=108 Identities=18% Similarity=0.160 Sum_probs=74.3
Q ss_pred eEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEee--cCCceeEEEcCCC---cEEEEcCCcEEEEcCCCCCccccccc
Q 040274 112 VSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTL--TGHAKTLDFSQKG---LLAVGTGSFAQILGDFSGSHNYSRYM 186 (359)
Q Consensus 112 v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~--~~~v~~~~~s~~g---l~~~~~d~~i~v~d~~~~~~~~~~~~ 186 (359)
-....|-|.+..++.++.+..+..||-. ++.+... ++...+++|.-+| ++.+-..+.+.+||+.......-...
T Consensus 37 pi~~~w~~e~~nlavaca~tiv~~YD~a-gq~~le~n~tg~aldm~wDkegdvlavlAek~~piylwd~n~eytqqLE~g 115 (615)
T KOG2247|consen 37 PIIHRWRPEGHNLAVACANTIVIYYDKA-GQVILELNPTGKALDMAWDKEGDVLAVLAEKTGPIYLWDVNSEYTQQLESG 115 (615)
T ss_pred cceeeEecCCCceehhhhhhHHHhhhhh-cceecccCCchhHhhhhhccccchhhhhhhcCCCeeechhhhhhHHHHhcc
Confidence 3445678888789999999999999854 5554444 5667888998888 55666789999999755422221111
Q ss_pred cccCCCCcceeEEEEccCCCEEEEEeCCCeEEEEEcCCC
Q 040274 187 GNSMVKGYQIGKVSFRPYEDVLGIGHSMGWSGILVPRSS 225 (359)
Q Consensus 187 ~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~~~i~~~gs~ 225 (359)
+. + .-.=+.|++.+..++.|...|.+.|+..|..
T Consensus 116 g~---~--s~sll~wsKg~~el~ig~~~gn~viynhgts 149 (615)
T KOG2247|consen 116 GT---S--SKSLLAWSKGTPELVIGNNAGNIVIYNHGTS 149 (615)
T ss_pred Cc---c--hHHHHhhccCCccccccccccceEEEeccch
Confidence 11 1 1222789999999999988888888765544
No 470
>PF12768 Rax2: Cortical protein marker for cell polarity
Probab=84.04 E-value=16 Score=32.57 Aligned_cols=87 Identities=16% Similarity=0.263 Sum_probs=55.1
Q ss_pred CCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEec------CCCeEEEEEcCCCee--e-----EeecCCceeE
Q 040274 88 GGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTG------KECKIKIWDLRKYEV--L-----QTLTGHAKTL 154 (359)
Q Consensus 88 dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~------~d~~i~vwd~~~~~~--~-----~~~~~~v~~~ 154 (359)
-..|++||+.+.+...--.+-.+.|+++.|..+..+++.|. ....+-.||..+... + ..++++++.+
T Consensus 15 C~~lC~yd~~~~qW~~~g~~i~G~V~~l~~~~~~~Llv~G~ft~~~~~~~~la~yd~~~~~w~~~~~~~s~~ipgpv~a~ 94 (281)
T PF12768_consen 15 CPGLCLYDTDNSQWSSPGNGISGTVTDLQWASNNQLLVGGNFTLNGTNSSNLATYDFKNQTWSSLGGGSSNSIPGPVTAL 94 (281)
T ss_pred CCEEEEEECCCCEeecCCCCceEEEEEEEEecCCEEEEEEeeEECCCCceeEEEEecCCCeeeecCCcccccCCCcEEEE
Confidence 35699999887665444444568899999986666666664 345688899876532 1 1235677777
Q ss_pred EEcCC-C--cE-EEE-c--CCcEEEEc
Q 040274 155 DFSQK-G--LL-AVG-T--GSFAQILG 174 (359)
Q Consensus 155 ~~s~~-g--l~-~~~-~--d~~i~v~d 174 (359)
.+..+ + ++ ++. . +..|..||
T Consensus 95 ~~~~~d~~~~~~aG~~~~g~~~l~~~d 121 (281)
T PF12768_consen 95 TFISNDGSNFWVAGRSANGSTFLMKYD 121 (281)
T ss_pred EeeccCCceEEEeceecCCCceEEEEc
Confidence 77433 2 43 333 2 24567776
No 471
>KOG3522 consensus Predicted guanine nucleotide exchange factor [Signal transduction mechanisms]
Probab=83.65 E-value=3.4 Score=41.60 Aligned_cols=132 Identities=8% Similarity=0.097 Sum_probs=77.1
Q ss_pred CEEEEEeCCCeEEEEeCCCCc-ceEE--e-ecCCCCeEEEEEecCCCEEEEecCCCeEEE--------EEcCCCeeeEee
Q 040274 80 GVVSLGHSGGTVTMWKPTTSA-LLIK--M-LYHQGPVSALAFHPNGHLMATTGKECKIKI--------WDLRKYEVLQTL 147 (359)
Q Consensus 80 ~~l~tg~~dg~v~lwd~~~~~-~~~~--~-~~h~~~v~~l~~~p~g~~l~s~~~d~~i~v--------wd~~~~~~~~~~ 147 (359)
..+..|+.+|.+.++.-..+. .... + ......+.++.+++. .+..|..||++-. ||......+..-
T Consensus 548 PTic~gtq~ssisissss~~s~ke~~~~~~spe~~~v~~l~~ss~--Slgagl~dgt~a~y~rap~gSwd~ep~~~~~~g 625 (925)
T KOG3522|consen 548 PTICLGTQTSSISISSSSLDSIKEVTSEPPSPEHESVKLLLFSSG--SLGAGLIDGTLAVYGRAPSGSWDGEPNISIPTG 625 (925)
T ss_pred CcccccCccceeEEeeccCCcccceeccCCCCchhhhhhhhcccc--ccccCccCCccccccCCCCCCCCCCCccccccC
Confidence 357788889999999765221 1111 1 122345566665543 2333444444433 555422333333
Q ss_pred cCCceeEEEcCCCcEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCCCe
Q 040274 148 TGHAKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSMGW 216 (359)
Q Consensus 148 ~~~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~dg~ 216 (359)
..++.+..+..| ++.++.+|.|.|+...+.. .......|.. +...|+++.+...|-+++.++.+-.
T Consensus 626 ~lPvrsla~~ed-~~was~gG~V~vi~~tt~~-~~~~leahqe-e~~~Vthm~~~~~gVwvafasG~~~ 691 (925)
T KOG3522|consen 626 SLPVRSLAFQED-FVWASEGGCVHVIPSTTFI-RSWDLEAHQE-EAHSVTHMLYLDNGVWVAFASGDEE 691 (925)
T ss_pred Cccccchhhhhc-eeeeecCCceEEEechhcc-ccchhHHHHh-hcceEEEEEeeCCceEEEEcCCCEE
Confidence 556777777655 6778889999999865432 2222233322 3447999999888888777766643
No 472
>KOG2377 consensus Uncharacterized conserved protein [Function unknown]
Probab=83.29 E-value=42 Score=31.85 Aligned_cols=95 Identities=7% Similarity=0.108 Sum_probs=63.2
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcce----EEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCC----
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALL----IKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRK---- 140 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~----~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~---- 140 (359)
+|.++.||+|++.|++--.+.+|.+++....++. .+.+..+..|.+..|+.+ .-+|..+..| +-+|....
T Consensus 68 ~I~SIkFSlDnkilAVQR~~~~v~f~nf~~d~~~l~~~~~ck~k~~~IlGF~W~~s-~e~A~i~~~G-~e~y~v~pekrs 145 (657)
T KOG2377|consen 68 EIKSIKFSLDNKILAVQRTSKTVDFCNFIPDNSQLEYTQECKTKNANILGFCWTSS-TEIAFITDQG-IEFYQVLPEKRS 145 (657)
T ss_pred ceeEEEeccCcceEEEEecCceEEEEecCCCchhhHHHHHhccCcceeEEEEEecC-eeEEEEecCC-eEEEEEchhhhh
Confidence 8999999999999999999999999987433322 222233456888899766 4455555444 55554432
Q ss_pred CeeeEeecCCceeEEEcCCC---cEEEE
Q 040274 141 YEVLQTLTGHAKTLDFSQKG---LLAVG 165 (359)
Q Consensus 141 ~~~~~~~~~~v~~~~~s~~g---l~~~~ 165 (359)
...+.+....|+-..|+++. +++.+
T Consensus 146 lRlVks~~~nvnWy~yc~et~v~LL~t~ 173 (657)
T KOG2377|consen 146 LRLVKSHNLNVNWYMYCPETAVILLSTT 173 (657)
T ss_pred hhhhhhcccCccEEEEccccceEeeecc
Confidence 23344445567788888887 44444
No 473
>PF14269 Arylsulfotran_2: Arylsulfotransferase (ASST)
Probab=83.09 E-value=32 Score=30.98 Aligned_cols=64 Identities=9% Similarity=0.242 Sum_probs=46.4
Q ss_pred eEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEeecCC-cee-------EEEcCCC-cE-EEEcCCcEEEEcC
Q 040274 112 VSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQTLTGH-AKT-------LDFSQKG-LL-AVGTGSFAQILGD 175 (359)
Q Consensus 112 v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~~~~~-v~~-------~~~s~~g-l~-~~~~d~~i~v~d~ 175 (359)
++++...++|.+|+|+-.-..|.+.|..+|+.+..+.++ -.+ ++|-.+- ++ ....++.|.|||-
T Consensus 146 iNsV~~~~~G~yLiS~R~~~~i~~I~~~tG~I~W~lgG~~~~df~~~~~~f~~QHdar~~~~~~~~~~IslFDN 219 (299)
T PF14269_consen 146 INSVDKDDDGDYLISSRNTSTIYKIDPSTGKIIWRLGGKRNSDFTLPATNFSWQHDARFLNESNDDGTISLFDN 219 (299)
T ss_pred eeeeeecCCccEEEEecccCEEEEEECCCCcEEEEeCCCCCCcccccCCcEeeccCCEEeccCCCCCEEEEEcC
Confidence 678888889999999988899999999999999988554 222 3332222 33 2235678999983
No 474
>PF03088 Str_synth: Strictosidine synthase; InterPro: IPR018119 This entry represents a conserved region found in strictosidine synthase (4.3.3.2 from EC), a key enzyme in alkaloid biosynthesis. It catalyses the Pictet-Spengler stereospecific condensation of tryptamine with secologanin to form strictosidine []. The structure of the native enzyme from the Indian medicinal plant Rauvolfia serpentina (Serpentwood) (Devilpepper) represents the first example of a six-bladed four-stranded beta-propeller fold from the plant kingdom [].; GO: 0016844 strictosidine synthase activity, 0009058 biosynthetic process; PDB: 2FPB_A 2V91_B 2FP8_A 3V1S_B 2FPC_A 2VAQ_A 2FP9_B.
Probab=82.96 E-value=11 Score=27.12 Aligned_cols=42 Identities=14% Similarity=0.233 Sum_probs=28.0
Q ss_pred EeCCCeEEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEe
Q 040274 85 GHSGGTVTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATT 127 (359)
Q Consensus 85 g~~dg~v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~ 127 (359)
+..+|.+..||+.+++....+.+ -..-+.+++++|+.+++.+
T Consensus 33 ~~~~GRll~ydp~t~~~~vl~~~-L~fpNGVals~d~~~vlv~ 74 (89)
T PF03088_consen 33 GRPTGRLLRYDPSTKETTVLLDG-LYFPNGVALSPDESFVLVA 74 (89)
T ss_dssp T---EEEEEEETTTTEEEEEEEE-ESSEEEEEE-TTSSEEEEE
T ss_pred CCCCcCEEEEECCCCeEEEehhC-CCccCeEEEcCCCCEEEEE
Confidence 44578899999999875444433 3456899999999976665
No 475
>TIGR03118 PEPCTERM_chp_1 conserved hypothetical protein TIGR03118. This model describes and uncharacterized conserved hypothetical protein. Members are found with the C-terminal putative exosortase interaction domain, PEP-CTERM, in Nitrosospira multiformis, Rhodoferax ferrireducens, Solibacter usitatus Ellin6076, and Acidobacteria bacterium Ellin345. It is found without the PEP-CTERM domain in several other species, including Burkholderia ambifaria, Gloeobacter violaceus PCC 7421, and three copies in the Acanthamoeba polyphaga mimivirus.
Probab=82.96 E-value=35 Score=30.65 Aligned_cols=107 Identities=12% Similarity=0.127 Sum_probs=63.8
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCC------CCcc-eEEeec-----CCCCeEEEEEecCCC------------EE
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPT------TSAL-LIKMLY-----HQGPVSALAFHPNGH------------LM 124 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~------~~~~-~~~~~~-----h~~~v~~l~~~p~g~------------~l 124 (359)
.-+.|+++|.+.+-++....+...+||.. ...+ +.++.. .....+.+.|+.... .+
T Consensus 24 N~WGia~~p~~~~WVadngT~~~TlYdg~~~~~~g~~~~L~vtiP~~~~~~~~~~PTGiVfN~~~~F~vt~~g~~~~a~F 103 (336)
T TIGR03118 24 NAWGLSYRPGGPFWVANTGTGTATLYVGNPDTQPLVQDPLVVVIPAPPPLAAEGTPTGQVFNGSDTFVVSGEGITGPSRF 103 (336)
T ss_pred ccceeEecCCCCEEEecCCcceEEeecCCcccccCCccceEEEecCCCCCCCCCCccEEEEeCCCceEEcCCCcccceeE
Confidence 45678888877777777777888999876 2222 233331 124567788875332 36
Q ss_pred EEecCCCeEEEEEcCCCee-----eEee----cCCc-eeEEEcCC--C--cEEEEc-CCcEEEEcC
Q 040274 125 ATTGKECKIKIWDLRKYEV-----LQTL----TGHA-KTLDFSQK--G--LLAVGT-GSFAQILGD 175 (359)
Q Consensus 125 ~s~~~d~~i~vwd~~~~~~-----~~~~----~~~v-~~~~~s~~--g--l~~~~~-d~~i~v~d~ 175 (359)
+.++.||+|.-|...-+.. ...+ .+.| ..+++... + |+++.. .++|.|||-
T Consensus 104 if~tEdGTisaW~p~v~~t~~~~~~~~~d~s~~gavYkGLAi~~~~~~~~LYaadF~~g~IDVFd~ 169 (336)
T TIGR03118 104 LFVTEDGTLSGWAPALGTTRMTRAEIVVDASQQGNVYKGLAVGPTGGGDYLYAANFRQGRIDVFKG 169 (336)
T ss_pred EEEeCCceEEeecCcCCcccccccEEEEccCCCcceeeeeEEeecCCCceEEEeccCCCceEEecC
Confidence 7788999999998532211 1222 1233 34555433 3 444443 589999984
No 476
>PF05935 Arylsulfotrans: Arylsulfotransferase (ASST); InterPro: IPR010262 This family consists of several bacterial arylsulphotransferase proteins. Arylsulphotransferase (ASST) transfers a sulphate group from phenolic sulphate esters to a phenolic acceptor substrate [].; PDB: 3ETT_B 3ELQ_A 3ETS_A.
Probab=82.29 E-value=36 Score=32.91 Aligned_cols=53 Identities=11% Similarity=0.092 Sum_probs=28.0
Q ss_pred EEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEeecCCC---CeEEEEEecCCCEEEEec
Q 040274 73 MRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKMLYHQG---PVSALAFHPNGHLMATTG 128 (359)
Q Consensus 73 l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~h~~---~v~~l~~~p~g~~l~s~~ 128 (359)
+.+.++|.+++... ..+..+|+. |+.+..+....+ .-+.+.+.|+|++|+.+.
T Consensus 153 ~~~l~nG~ll~~~~--~~~~e~D~~-G~v~~~~~l~~~~~~~HHD~~~l~nGn~L~l~~ 208 (477)
T PF05935_consen 153 FKQLPNGNLLIGSG--NRLYEIDLL-GKVIWEYDLPGGYYDFHHDIDELPNGNLLILAS 208 (477)
T ss_dssp EEE-TTS-EEEEEB--TEEEEE-TT---EEEEEE--TTEE-B-S-EEE-TTS-EEEEEE
T ss_pred eeEcCCCCEEEecC--CceEEEcCC-CCEEEeeecCCcccccccccEECCCCCEEEEEe
Confidence 56677887776554 778888875 555554442221 135677889999988777
No 477
>PF07676 PD40: WD40-like Beta Propeller Repeat; InterPro: IPR011659 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events. This region appears to be related to the IPR001680 from INTERPRO repeat. This model is likely to miss copies within a sequence.; PDB: 2HQS_D 1C5K_A 2IVZ_A 2W8B_D 3IAX_A 1CRZ_A 1N6F_D 1N6D_C 1N6E_C 1K32_A ....
Probab=82.06 E-value=5.8 Score=23.08 Aligned_cols=29 Identities=21% Similarity=0.404 Sum_probs=17.9
Q ss_pred CCCCeEEEEEecCCCEEEEecC-C--CeEEEE
Q 040274 108 HQGPVSALAFHPNGHLMATTGK-E--CKIKIW 136 (359)
Q Consensus 108 h~~~v~~l~~~p~g~~l~s~~~-d--~~i~vw 136 (359)
..+.-.+..|+|||+.|+.++. + |...||
T Consensus 7 ~~~~~~~p~~SpDGk~i~f~s~~~~~g~~diy 38 (39)
T PF07676_consen 7 SPGDDGSPAWSPDGKYIYFTSNRNDRGSFDIY 38 (39)
T ss_dssp SSSSEEEEEE-TTSSEEEEEEECT--SSEEEE
T ss_pred CCccccCEEEecCCCEEEEEecCCCCCCcCEE
Confidence 3456677889999988766553 3 444444
No 478
>COG5276 Uncharacterized conserved protein [Function unknown]
Probab=81.57 E-value=39 Score=30.20 Aligned_cols=137 Identities=13% Similarity=0.034 Sum_probs=80.8
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEe--ecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCe---e
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKM--LYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYE---V 143 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~--~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~---~ 143 (359)
-+..+.++ +.+.+.+..+.-++|.|+.+......+ ..-.+. +-.|.-.|++...+..|.-+-+.|+.+.+ .
T Consensus 88 l~~Dv~vs--e~yvyvad~ssGL~IvDIS~P~sP~~~~~lnt~gy--aygv~vsGn~aYVadlddgfLivdvsdpssP~l 163 (370)
T COG5276 88 LFADVRVS--EEYVYVADWSSGLRIVDISTPDSPTLIGFLNTDGY--AYGVYVSGNYAYVADLDDGFLIVDVSDPSSPQL 163 (370)
T ss_pred hhheeEec--ccEEEEEcCCCceEEEeccCCCCcceeccccCCce--EEEEEecCCEEEEeeccCcEEEEECCCCCCcee
Confidence 34455554 446667777778999998876432221 111233 33344568899988877778888987643 2
Q ss_pred eEee--c-CCceeEEEcCCCcEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEe
Q 040274 144 LQTL--T-GHAKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGH 212 (359)
Q Consensus 144 ~~~~--~-~~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~ 212 (359)
.-.+ . +....++.|.+--+.+..|+.+.|.|+.+...+ .+.++.. .+..+.++..+++-.+++...
T Consensus 164 agrya~~~~d~~~v~ISGn~AYvA~~d~GL~ivDVSnp~sP--vli~~~n-~g~g~~sv~vsdnr~y~vvy~ 232 (370)
T COG5276 164 AGRYALPGGDTHDVAISGNYAYVAWRDGGLTIVDVSNPHSP--VLIGSYN-TGPGTYSVSVSDNRAYLVVYD 232 (370)
T ss_pred eeeeccCCCCceeEEEecCeEEEEEeCCCeEEEEccCCCCC--eEEEEEe-cCCceEEEEecCCeeEEEEcc
Confidence 2222 2 223566776554445557888999997654322 2333322 333578888887766655443
No 479
>PRK13613 lipoprotein LpqB; Provisional
Probab=81.55 E-value=42 Score=33.51 Aligned_cols=141 Identities=12% Similarity=0.042 Sum_probs=75.2
Q ss_pred ceeEEEEcCCCCEEEEEeCCC-eEEEEeCCCCcc----e-EEeecCCCCeEEEEEecCCCEEEEecC--CC--eEEEEEc
Q 040274 69 RTDLMRVNPFNGVVSLGHSGG-TVTMWKPTTSAL----L-IKMLYHQGPVSALAFHPNGHLMATTGK--EC--KIKIWDL 138 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg-~v~lwd~~~~~~----~-~~~~~h~~~v~~l~~~p~g~~l~s~~~--d~--~i~vwd~ 138 (359)
.+.+++.++++..++..+.++ .+++..+..+.. . ..+. ...++..+|.++| .+-+... ++ .+.+..-
T Consensus 364 ~~~s~avS~~g~~~A~v~~~~~~l~vg~~~~~~~~~~~~~~~~~--~~~Lt~PS~d~~g-~vWtvd~~~~~~~vl~v~~~ 440 (599)
T PRK13613 364 PLRRVAVSRDESRAAGISADGDSVYVGSLTPGASIGVHSWGVTA--DGRLTSPSWDGRG-DLWVVDRDPADPRLLWLLQG 440 (599)
T ss_pred CccceEEcCCCceEEEEcCCCcEEEEeccCCCCccccccceeec--cCcccCCcCcCCC-CEEEecCCCCCceEEEEEcC
Confidence 567888999988888777665 455554433322 1 1122 3346778888887 4445422 22 2555543
Q ss_pred CCCeeeE----eecC-CceeEEEcCCC--cEE-EEc--CCcEEEEcCCCCCccccccccc-c-CCCCcceeEEEEccCCC
Q 040274 139 RKYEVLQ----TLTG-HAKTLDFSQKG--LLA-VGT--GSFAQILGDFSGSHNYSRYMGN-S-MVKGYQIGKVSFRPYED 206 (359)
Q Consensus 139 ~~~~~~~----~~~~-~v~~~~~s~~g--l~~-~~~--d~~i~v~d~~~~~~~~~~~~~~-~-~~~~~~v~~~~~sp~~~ 206 (359)
+++... .+.+ .|+.+..|+|| ++. ... .+.|+|--+.....-...+... . ......+.+++|..++.
T Consensus 441 -~G~~~~V~~~~l~g~~I~~lrvSrDG~RvAvv~~~~g~~~v~va~V~R~~~G~~~l~~~~~l~~~l~~v~~~~W~~~~s 519 (599)
T PRK13613 441 -DGEPVEVRTPELDGHRVVAVRVARDGVRVALIVEKDGRRSLQIGRIVRDAKAVVSVEEFRSLAPELEDVTDMSWAGDSQ 519 (599)
T ss_pred -CCcEEEeeccccCCCEeEEEEECCCccEEEEEEecCCCcEEEEEEEEeCCCCcEEeeccEEeccCCCccceeEEcCCCE
Confidence 444321 1134 79999999999 222 222 2455543322211110111110 0 00112489999999998
Q ss_pred EEEEEeC
Q 040274 207 VLGIGHS 213 (359)
Q Consensus 207 ~l~~g~~ 213 (359)
+++.|..
T Consensus 520 L~Vlg~~ 526 (599)
T PRK13613 520 LVVLGRE 526 (599)
T ss_pred EEEEecc
Confidence 8776643
No 480
>COG4590 ABC-type uncharacterized transport system, permease component [General function prediction only]
Probab=80.34 E-value=14 Score=34.84 Aligned_cols=100 Identities=10% Similarity=0.028 Sum_probs=58.3
Q ss_pred CCEEEEEeCCCeEEEE-eCC-CCcc----eEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEEcCCCeeeEe--ecCC
Q 040274 79 NGVVSLGHSGGTVTMW-KPT-TSAL----LIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWDLRKYEVLQT--LTGH 150 (359)
Q Consensus 79 ~~~l~tg~~dg~v~lw-d~~-~~~~----~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd~~~~~~~~~--~~~~ 150 (359)
|..+.+++.||.|.-| |.+ ++.+ +..+.-...++..+.-..+-+-+++-+..|++.++.......+.. .-..
T Consensus 280 g~SLLv~~~dG~vsQWFdvr~~~~p~l~h~R~f~l~pa~~~~l~pe~~rkgF~~l~~~G~L~~f~st~~~~lL~~~~~~~ 359 (733)
T COG4590 280 GFSLLVVHEDGLVSQWFDVRRDGQPHLNHIRNFKLAPAEVQFLLPETNRKGFYSLYRNGTLQSFYSTSEKLLLFERAYQA 359 (733)
T ss_pred ceeEEEEcCCCceeeeeeeecCCCCcceeeeccccCcccceeeccccccceEEEEcCCCceeeeecccCcceehhhhhcC
Confidence 4457788899999888 333 2222 122222223333333222344577777778777775443332211 1234
Q ss_pred ceeEEEcCCC-cEEEEcCCcEEEEcCCCC
Q 040274 151 AKTLDFSQKG-LLAVGTGSFAQILGDFSG 178 (359)
Q Consensus 151 v~~~~~s~~g-l~~~~~d~~i~v~d~~~~ 178 (359)
+.-+++||++ .+..-..|.++++.+.+.
T Consensus 360 ~~~~~~Sp~~~~Ll~e~~gki~~~~l~Nr 388 (733)
T COG4590 360 PQLVAMSPNQAYLLSEDQGKIRLAQLENR 388 (733)
T ss_pred cceeeeCcccchheeecCCceEEEEecCC
Confidence 5678999999 776777789999986554
No 481
>TIGR03548 mutarot_permut cyclically-permuted mutatrotase family protein. Members of this protein family show essentially full-length homology, cyclically permuted, to YjhT from Escherichia coli. YjhT was shown to act as a mutarotase for sialic acid, and by this ability to be able to act as a virulence factor. Members of the YjhT family (TIGR03547) and this cyclically-permuted family have multiple repeats of the beta-propeller-forming Kelch repeat.
Probab=79.11 E-value=38 Score=30.65 Aligned_cols=52 Identities=10% Similarity=0.061 Sum_probs=28.1
Q ss_pred eEEEEeCCCCcceE--EeecCCCCeEEEEEecCCCEEEEecCCC----eEEEEEcCCCe
Q 040274 90 TVTMWKPTTSALLI--KMLYHQGPVSALAFHPNGHLMATTGKEC----KIKIWDLRKYE 142 (359)
Q Consensus 90 ~v~lwd~~~~~~~~--~~~~h~~~v~~l~~~p~g~~l~s~~~d~----~i~vwd~~~~~ 142 (359)
.+..||+.+.+... .+.. .......+...++.+++.|+.++ .+.+||+.+.+
T Consensus 140 ~v~~yd~~~~~W~~~~~~p~-~~r~~~~~~~~~~~iYv~GG~~~~~~~~~~~yd~~~~~ 197 (323)
T TIGR03548 140 KSYLFNLETQEWFELPDFPG-EPRVQPVCVKLQNELYVFGGGSNIAYTDGYKYSPKKNQ 197 (323)
T ss_pred eEEEEcCCCCCeeECCCCCC-CCCCcceEEEECCEEEEEcCCCCccccceEEEecCCCe
Confidence 57788887654322 1211 11122222334667777777654 35688887654
No 482
>smart00564 PQQ beta-propeller repeat. Beta-propeller repeat occurring in enzymes with pyrrolo-quinoline quinone (PQQ) as cofactor, in Ire1p-like Ser/Thr kinases, and in prokaryotic dehydrogenases.
Probab=78.88 E-value=5.1 Score=22.18 Aligned_cols=26 Identities=27% Similarity=0.440 Sum_probs=21.0
Q ss_pred CEEEEEeCCCeEEEEeCCCCcceEEe
Q 040274 80 GVVSLGHSGGTVTMWKPTTSALLIKM 105 (359)
Q Consensus 80 ~~l~tg~~dg~v~lwd~~~~~~~~~~ 105 (359)
..+++++.+|.+..+|..+|+.+..+
T Consensus 7 ~~v~~~~~~g~l~a~d~~~G~~~W~~ 32 (33)
T smart00564 7 GTVYVGSTDGTLYALDAKTGEILWTY 32 (33)
T ss_pred CEEEEEcCCCEEEEEEcccCcEEEEc
Confidence 36778888999999999988876543
No 483
>PF10214 Rrn6: RNA polymerase I-specific transcription-initiation factor; InterPro: IPR019350 RNA polymerase I-specific transcription-initiation factor Rrn6 and Rrn7 represent components of a multisubunit transcription factor essential for the initiation of rDNA transcription by Pol I []. These proteins are found in fungi.
Probab=78.84 E-value=21 Score=36.93 Aligned_cols=109 Identities=15% Similarity=0.242 Sum_probs=64.4
Q ss_pred ceeEEEEc---C----CCCEEEEEeCCCeEEEEeCCC---------------CcceEEeec---CCCCeEEEEEec-CCC
Q 040274 69 RTDLMRVN---P----FNGVVSLGHSGGTVTMWKPTT---------------SALLIKMLY---HQGPVSALAFHP-NGH 122 (359)
Q Consensus 69 ~v~~l~~s---p----~~~~l~tg~~dg~v~lwd~~~---------------~~~~~~~~~---h~~~v~~l~~~p-~g~ 122 (359)
+|..|+|. . ...+|++- ....+.|+.+.- ..++..+.. ...+...++|+| +..
T Consensus 81 PI~qI~fa~~~~~~~~~~~~l~Vr-t~~st~I~~p~~~~~~~~~~~~~s~i~~~~l~~i~~~~tgg~~~aDv~FnP~~~~ 159 (765)
T PF10214_consen 81 PIKQIKFATLSESFDEKSRWLAVR-TETSTTILRPEYHRVISSIRSRPSRIDPNPLLTISSSDTGGFPHADVAFNPWDQR 159 (765)
T ss_pred CeeEEEecccccccCCcCcEEEEE-cCCEEEEEEcccccccccccCCccccccceeEEechhhcCCCccceEEeccCccc
Confidence 77888887 2 12344443 345566666211 123444432 234678899999 556
Q ss_pred EEEEecCCCeEEEEEcCCC--------eeeEeecCCc----------eeEEEcCCC-cEEEEcCCcEEEEcCCCC
Q 040274 123 LMATTGKECKIKIWDLRKY--------EVLQTLTGHA----------KTLDFSQKG-LLAVGTGSFAQILGDFSG 178 (359)
Q Consensus 123 ~l~s~~~d~~i~vwd~~~~--------~~~~~~~~~v----------~~~~~s~~g-l~~~~~d~~i~v~d~~~~ 178 (359)
.||.....|+..|||+... .......|.+ ..+.|.++. .+.++....+.++|+...
T Consensus 160 q~AiVD~~G~Wsvw~i~~~~~~~~~~~~~~~~~~gsi~~d~~e~s~w~rI~W~~~~~~lLv~~r~~l~~~d~~~~ 234 (765)
T PF10214_consen 160 QFAIVDEKGNWSVWDIKGRPKRKSSNLRLSRNISGSIIFDPEELSNWKRILWVSDSNRLLVCNRSKLMLIDFESN 234 (765)
T ss_pred eEEEEeccCcEEEEEeccccccCCcceeeccCCCccccCCCcccCcceeeEecCCCCEEEEEcCCceEEEECCCC
Confidence 7999999999999999211 1111112222 367787775 555555677888886544
No 484
>PF03088 Str_synth: Strictosidine synthase; InterPro: IPR018119 This entry represents a conserved region found in strictosidine synthase (4.3.3.2 from EC), a key enzyme in alkaloid biosynthesis. It catalyses the Pictet-Spengler stereospecific condensation of tryptamine with secologanin to form strictosidine []. The structure of the native enzyme from the Indian medicinal plant Rauvolfia serpentina (Serpentwood) (Devilpepper) represents the first example of a six-bladed four-stranded beta-propeller fold from the plant kingdom [].; GO: 0016844 strictosidine synthase activity, 0009058 biosynthetic process; PDB: 2FPB_A 2V91_B 2FP8_A 3V1S_B 2FPC_A 2VAQ_A 2FP9_B.
Probab=78.19 E-value=19 Score=25.86 Aligned_cols=41 Identities=12% Similarity=0.087 Sum_probs=25.8
Q ss_pred ecCCCeEEEEEcCCCeeeEeec--CCceeEEEcCCC-cEEEEcC
Q 040274 127 TGKECKIKIWDLRKYEVLQTLT--GHAKTLDFSQKG-LLAVGTG 167 (359)
Q Consensus 127 ~~~d~~i~vwd~~~~~~~~~~~--~~v~~~~~s~~g-l~~~~~d 167 (359)
+..+|.+..||+.+++...-+. ...+.|++++|+ ++..+.-
T Consensus 33 ~~~~GRll~ydp~t~~~~vl~~~L~fpNGVals~d~~~vlv~Et 76 (89)
T PF03088_consen 33 GRPTGRLLRYDPSTKETTVLLDGLYFPNGVALSPDESFVLVAET 76 (89)
T ss_dssp T---EEEEEEETTTTEEEEEEEEESSEEEEEE-TTSSEEEEEEG
T ss_pred CCCCcCEEEEECCCCeEEEehhCCCccCeEEEcCCCCEEEEEec
Confidence 3456789999999887533332 356899999999 5555443
No 485
>PRK13613 lipoprotein LpqB; Provisional
Probab=78.06 E-value=41 Score=33.59 Aligned_cols=108 Identities=12% Similarity=0.096 Sum_probs=63.3
Q ss_pred ceEEeecCCC-CeEEEEEecCCCEEEEecCCC-eEEEEEcCCCee----e-Eee-cCCceeEEEcCCC-cEEEEc--CC-
Q 040274 101 LLIKMLYHQG-PVSALAFHPNGHLMATTGKEC-KIKIWDLRKYEV----L-QTL-TGHAKTLDFSQKG-LLAVGT--GS- 168 (359)
Q Consensus 101 ~~~~~~~h~~-~v~~l~~~p~g~~l~s~~~d~-~i~vwd~~~~~~----~-~~~-~~~v~~~~~s~~g-l~~~~~--d~- 168 (359)
++.-..++.. .+.+++.++++..++..+.++ .+++..+..+.. . ..+ ...++...|.++| +.++.. ++
T Consensus 353 pv~g~~g~~~~~~~s~avS~~g~~~A~v~~~~~~l~vg~~~~~~~~~~~~~~~~~~~~Lt~PS~d~~g~vWtvd~~~~~~ 432 (599)
T PRK13613 353 PVPGALGSGRVPLRRVAVSRDESRAAGISADGDSVYVGSLTPGASIGVHSWGVTADGRLTSPSWDGRGDLWVVDRDPADP 432 (599)
T ss_pred cCCCccCCCCCCccceEEcCCCceEEEEcCCCcEEEEeccCCCCccccccceeeccCcccCCcCcCCCCEEEecCCCCCc
Confidence 3333334444 678999999999988877665 566655533322 1 122 3457888899988 655533 22
Q ss_pred -cEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEe
Q 040274 169 -FAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGH 212 (359)
Q Consensus 169 -~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~ 212 (359)
.++++.. .+ .... ...... .+..|..+..|+||-.++.-.
T Consensus 433 ~vl~v~~~-~G-~~~~-V~~~~l-~g~~I~~lrvSrDG~RvAvv~ 473 (599)
T PRK13613 433 RLLWLLQG-DG-EPVE-VRTPEL-DGHRVVAVRVARDGVRVALIV 473 (599)
T ss_pred eEEEEEcC-CC-cEEE-eecccc-CCCEeEEEEECCCccEEEEEE
Confidence 2666652 22 2221 211111 333799999999997766544
No 486
>TIGR03032 conserved hypothetical protein TIGR03032. This protein family is uncharacterized. A number of motifs are conserved perfectly among all member sequences. The function of this protein is unknown.
Probab=77.88 E-value=31 Score=31.13 Aligned_cols=44 Identities=23% Similarity=0.336 Sum_probs=34.9
Q ss_pred CCCEEEEecCCCeEEEEEcCCCe--eeEeecCCceeEEEcCCC-cEEEE
Q 040274 120 NGHLMATTGKECKIKIWDLRKYE--VLQTLTGHAKTLDFSQKG-LLAVG 165 (359)
Q Consensus 120 ~g~~l~s~~~d~~i~vwd~~~~~--~~~~~~~~v~~~~~s~~g-l~~~~ 165 (359)
+|++.++-+..|.|..+|..+|+ ++..+++....++|. | ++.+|
T Consensus 212 dgrLwvldsgtGev~~vD~~~G~~e~Va~vpG~~rGL~f~--G~llvVg 258 (335)
T TIGR03032 212 QGKLWLLNSGRGELGYVDPQAGKFQPVAFLPGFTRGLAFA--GDFAFVG 258 (335)
T ss_pred CCeEEEEECCCCEEEEEcCCCCcEEEEEECCCCCccccee--CCEEEEE
Confidence 67888888889999999988774 566678889999998 5 54444
No 487
>TIGR02608 delta_60_rpt delta-60 repeat domain. This domain occurs in tandem repeats, as many as 13, in proteins from Bdellovibrio bacteriovorus, Azotobacter vinelandii, Geobacter sulfurreducens, Pirellula sp. 1, Myxococcus xanthus, and others, many of which are Deltaproteobacteria. The periodicity of the repeat ranges from about 57 to 61 amino acids, and a core region of about 54 is represented by this model and seed alignment.
Probab=77.87 E-value=8.9 Score=24.73 Aligned_cols=16 Identities=13% Similarity=0.073 Sum_probs=8.0
Q ss_pred eEEEEcCCCCEEEEEe
Q 040274 71 DLMRVNPFNGVVSLGH 86 (359)
Q Consensus 71 ~~l~~sp~~~~l~tg~ 86 (359)
.+++.-|||++|++|.
T Consensus 4 ~~~~~q~DGkIlv~G~ 19 (55)
T TIGR02608 4 YAVAVQSDGKILVAGY 19 (55)
T ss_pred EEEEECCCCcEEEEEE
Confidence 3444555555555553
No 488
>PF13449 Phytase-like: Esterase-like activity of phytase
Probab=77.16 E-value=44 Score=30.49 Aligned_cols=105 Identities=11% Similarity=0.134 Sum_probs=60.4
Q ss_pred CCCeEEEEEecCCCEEEEecCCCe------EEEEEcCC--C--eee---E--ee---cC--------CceeEEEcCCC-c
Q 040274 109 QGPVSALAFHPNGHLMATTGKECK------IKIWDLRK--Y--EVL---Q--TL---TG--------HAKTLDFSQKG-L 161 (359)
Q Consensus 109 ~~~v~~l~~~p~g~~l~s~~~d~~------i~vwd~~~--~--~~~---~--~~---~~--------~v~~~~~s~~g-l 161 (359)
-+.++++.+.|++..+++.+.+|. ++.+++.. + ..+ . .+ .+ ..-+|++.++| +
T Consensus 19 ~GGlSgl~~~~~~~~~~avSD~g~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~L~~~~G~~~~~~~~D~Egi~~~~~g~~ 98 (326)
T PF13449_consen 19 FGGLSGLDYDPDDGRFYAVSDRGPNKGPPRFYTFRIDYDQGGIGGVTILDMIPLRDPDGQPFPKNGLDPEGIAVPPDGSF 98 (326)
T ss_pred cCcEeeEEEeCCCCEEEEEECCCCCCCCCcEEEEEeeccCCCccceEeccceeccCCCCCcCCcCCCChhHeEEecCCCE
Confidence 456788999876666777777777 66666553 1 111 1 11 12 12478887777 4
Q ss_pred EEEE-cC------CcEEEEcCCCCCcccccc--cc---------ccCCCCcceeEEEEccCCCEEEEEeCCC
Q 040274 162 LAVG-TG------SFAQILGDFSGSHNYSRY--MG---------NSMVKGYQIGKVSFRPYEDVLGIGHSMG 215 (359)
Q Consensus 162 ~~~~-~d------~~i~v~d~~~~~~~~~~~--~~---------~~~~~~~~v~~~~~sp~~~~l~~g~~dg 215 (359)
+.+. .+ ..|..++.. + .....+ +. .....+....+++++|+|..|+++....
T Consensus 99 ~is~E~~~~~~~~p~I~~~~~~-G-~~~~~~~vP~~~~~~~~~~~~~~~N~G~E~la~~~dG~~l~~~~E~~ 168 (326)
T PF13449_consen 99 WISSEGGRTGGIPPRIRRFDLD-G-RVIRRFPVPAAFLPDANGTSGRRNNRGFEGLAVSPDGRTLFAAMESP 168 (326)
T ss_pred EEEeCCccCCCCCCEEEEECCC-C-cccceEccccccccccCccccccCCCCeEEEEECCCCCEEEEEECcc
Confidence 4444 34 567777743 2 222221 11 1111344688999999999777666554
No 489
>PF07250 Glyoxal_oxid_N: Glyoxal oxidase N-terminus; InterPro: IPR009880 This entry represents the N terminus (approximately 300 residues) of a number of plant and fungal glyoxal oxidase enzymes. Glyoxal oxidase catalyses the oxidation of aldehydes to carboxylic acids, coupled with reduction of dioxygen to hydrogen peroxide. It is an essential component of the extracellular lignin degradation pathways of the wood-rot fungus Phanerochaete chrysosporium [].
Probab=77.13 E-value=25 Score=30.57 Aligned_cols=126 Identities=14% Similarity=0.154 Sum_probs=64.3
Q ss_pred EEEEeCCCCcceEEeecCCCCeEEEEEecCCCEEEEecC-C--CeEEEEEcCCC--ee-eEeecC------CceeEEEcC
Q 040274 91 VTMWKPTTSALLIKMLYHQGPVSALAFHPNGHLMATTGK-E--CKIKIWDLRKY--EV-LQTLTG------HAKTLDFSQ 158 (359)
Q Consensus 91 v~lwd~~~~~~~~~~~~h~~~v~~l~~~p~g~~l~s~~~-d--~~i~vwd~~~~--~~-~~~~~~------~v~~~~~s~ 158 (359)
-.+||+.+++....-......+.+-.+-|||++|.+||. | ..+++++.... .+ ...... .=.+...-|
T Consensus 48 s~~yD~~tn~~rpl~v~td~FCSgg~~L~dG~ll~tGG~~~G~~~ir~~~p~~~~~~~~w~e~~~~m~~~RWYpT~~~L~ 127 (243)
T PF07250_consen 48 SVEYDPNTNTFRPLTVQTDTFCSGGAFLPDGRLLQTGGDNDGNKAIRIFTPCTSDGTCDWTESPNDMQSGRWYPTATTLP 127 (243)
T ss_pred EEEEecCCCcEEeccCCCCCcccCcCCCCCCCEEEeCCCCccccceEEEecCCCCCCCCceECcccccCCCccccceECC
Confidence 348999887543222122333444567789999999875 3 34788876541 11 111111 112344456
Q ss_pred CC--cEEEEcC-CcEEEEcCCCCCc-ccc-cccccc--CCCCcceeEEEEccCCCEEEEEeCCCe
Q 040274 159 KG--LLAVGTG-SFAQILGDFSGSH-NYS-RYMGNS--MVKGYQIGKVSFRPYEDVLGIGHSMGW 216 (359)
Q Consensus 159 ~g--l~~~~~d-~~i~v~d~~~~~~-~~~-~~~~~~--~~~~~~v~~~~~sp~~~~l~~g~~dg~ 216 (359)
|| ++.+|.. .+..+|.-..... ... .+.... ......--.+...|+|++++.+..++.
T Consensus 128 DG~vlIvGG~~~~t~E~~P~~~~~~~~~~~~~l~~~~~~~~~nlYP~~~llPdG~lFi~an~~s~ 192 (243)
T PF07250_consen 128 DGRVLIVGGSNNPTYEFWPPKGPGPGPVTLPFLSQTSDTLPNNLYPFVHLLPDGNLFIFANRGSI 192 (243)
T ss_pred CCCEEEEeCcCCCcccccCCccCCCCceeeecchhhhccCccccCceEEEcCCCCEEEEEcCCcE
Confidence 88 5555554 3455665321111 111 111110 001112335677899999988887763
No 490
>PF14761 HPS3_N: Hermansky-Pudlak syndrome 3
Probab=76.96 E-value=14 Score=31.33 Aligned_cols=59 Identities=7% Similarity=0.005 Sum_probs=39.0
Q ss_pred ceeEEEcCCC-cEEEEcCCcEEEEcCCCC-CccccccccccCCCCcceeEEEEccCCCEEEEEeCC
Q 040274 151 AKTLDFSQKG-LLAVGTGSFAQILGDFSG-SHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM 214 (359)
Q Consensus 151 v~~~~~s~~g-l~~~~~d~~i~v~d~~~~-~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d 214 (359)
...++-++.+ ++.+..++.|.+|++... ......+.+. +.|..+.++..|+||++-=.+
T Consensus 20 P~~~c~~g~d~Lfva~~g~~Vev~~l~~~~~~~~~~F~Tv-----~~V~~l~y~~~GDYlvTlE~k 80 (215)
T PF14761_consen 20 PTAVCCGGPDALFVAASGCKVEVYDLEQEECPLLCTFSTV-----GRVLQLVYSEAGDYLVTLEEK 80 (215)
T ss_pred cceeeccCCceEEEEcCCCEEEEEEcccCCCceeEEEcch-----hheeEEEeccccceEEEEEee
Confidence 4445555534 555577889999997632 2233344443 379999999999999975443
No 491
>KOG3616 consensus Selective LIM binding factor [Transcription]
Probab=76.01 E-value=7.4 Score=38.92 Aligned_cols=64 Identities=17% Similarity=0.347 Sum_probs=41.9
Q ss_pred ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcc--eEEeecCCCCeEEEEEecCCCEEEEecCCCeEEEEE
Q 040274 69 RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSAL--LIKMLYHQGPVSALAFHPNGHLMATTGKECKIKIWD 137 (359)
Q Consensus 69 ~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~--~~~~~~h~~~v~~l~~~p~g~~l~s~~~d~~i~vwd 137 (359)
.++++.-+|.++.+++++.||+|.+|+...... +... ..+-..+.|...| |+++..|..+--|.
T Consensus 16 ~~~aiqshp~~~s~v~~~~d~si~lfn~~~r~qski~~~---~~p~~nlv~tnhg--l~~~tsdrr~la~~ 81 (1636)
T KOG3616|consen 16 FTTAIQSHPGGQSFVLAHQDGSIILFNFIPRRQSKICEE---AKPKENLVFTNHG--LVTATSDRRALAWK 81 (1636)
T ss_pred eeeeeeecCCCceEEEEecCCcEEEEeecccchhhhhhh---cCCccceeeeccc--eEEEeccchhheee
Confidence 356777889999999999999999998654432 3222 2233445554444 55666666666664
No 492
>KOG1898 consensus Splicing factor 3b, subunit 3 [RNA processing and modification]
Probab=75.43 E-value=1.1e+02 Score=32.22 Aligned_cols=146 Identities=13% Similarity=0.155 Sum_probs=74.2
Q ss_pred ceeEEEEcCCC-C-EEEEEe-----------CCCeEEEEeCC-CCcceEEee--cCCCCeEEEEEecCCCEEEEecCCCe
Q 040274 69 RTDLMRVNPFN-G-VVSLGH-----------SGGTVTMWKPT-TSALLIKML--YHQGPVSALAFHPNGHLMATTGKECK 132 (359)
Q Consensus 69 ~v~~l~~sp~~-~-~l~tg~-----------~dg~v~lwd~~-~~~~~~~~~--~h~~~v~~l~~~p~g~~l~s~~~d~~ 132 (359)
.+..+.|+... . ++++|. .+|.++.|+.- .+..+.-+. .-.++|.+ .+|-..++++ +....
T Consensus 879 ~v~~~~fs~~~~~~~~~v~~~~~~~l~~~~~~~g~~ytyk~~~~g~~lellh~T~~~~~v~A--i~~f~~~~La-gvG~~ 955 (1205)
T KOG1898|consen 879 SVCAVDFSSSEYQPFVAVGVATTEQLDSKSISSGFVYTYKFVRNGDKLELLHKTEIPGPVGA--ICPFQGRVLA-GVGRF 955 (1205)
T ss_pred heeeeeeccCCCceEEEEEeeccccccccccCCCceEEEEEEecCceeeeeeccCCCccceE--EeccCCEEEE-ecccE
Confidence 56677776632 2 344443 23446666643 333222221 11234444 4565555544 45568
Q ss_pred EEEEEcCCCeeeEee-----cCCceeEEEcCCCcEEEEcCCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCE
Q 040274 133 IKIWDLRKYEVLQTL-----TGHAKTLDFSQKGLLAVGTGSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDV 207 (359)
Q Consensus 133 i~vwd~~~~~~~~~~-----~~~v~~~~~s~~gl~~~~~d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~ 207 (359)
+++||+-..++++.. +..|+.+++.-.-++.+...-.+.++--.........+..... + ..|+++.+- |.+.
T Consensus 956 l~~YdlG~K~lLRk~e~k~~p~~Is~iqt~~~RI~VgD~qeSV~~~~y~~~~n~l~~fadD~~-p-R~Vt~~~~l-D~~t 1032 (1205)
T KOG1898|consen 956 LRLYDLGKKKLLRKCELKFIPNRISSIQTYGARIVVGDIQESVHFVRYRREDNQLIVFADDPV-P-RHVTALELL-DYDT 1032 (1205)
T ss_pred EEEeeCChHHHHhhhhhccCceEEEEEeecceEEEEeeccceEEEEEEecCCCeEEEEeCCCc-c-ceeeEEEEe-cCCc
Confidence 999999876665544 4456777775554555554444443322233334444433321 1 246666655 4455
Q ss_pred EEEEeCCCeEEEE
Q 040274 208 LGIGHSMGWSGIL 220 (359)
Q Consensus 208 l~~g~~dg~~~i~ 220 (359)
++.|..-|.+.++
T Consensus 1033 vagaDrfGNi~~v 1045 (1205)
T KOG1898|consen 1033 VAGADRFGNIAVV 1045 (1205)
T ss_pred eeeccccCcEEEE
Confidence 6666666655543
No 493
>smart00564 PQQ beta-propeller repeat. Beta-propeller repeat occurring in enzymes with pyrrolo-quinoline quinone (PQQ) as cofactor, in Ire1p-like Ser/Thr kinases, and in prokaryotic dehydrogenases.
Probab=75.21 E-value=8.1 Score=21.32 Aligned_cols=24 Identities=17% Similarity=0.145 Sum_probs=19.8
Q ss_pred EEEEecCCCeEEEEEcCCCeeeEe
Q 040274 123 LMATTGKECKIKIWDLRKYEVLQT 146 (359)
Q Consensus 123 ~l~s~~~d~~i~vwd~~~~~~~~~ 146 (359)
.++.++.++.+..+|..+|+.+..
T Consensus 8 ~v~~~~~~g~l~a~d~~~G~~~W~ 31 (33)
T smart00564 8 TVYVGSTDGTLYALDAKTGEILWT 31 (33)
T ss_pred EEEEEcCCCEEEEEEcccCcEEEE
Confidence 577788899999999988887654
No 494
>KOG4460 consensus Nuclear pore complex, Nup88/rNup84 component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=74.87 E-value=36 Score=32.88 Aligned_cols=35 Identities=11% Similarity=0.096 Sum_probs=23.9
Q ss_pred ceeEEEEcCCC---CEEEEEeCCCeEEEEeCCCCcceE
Q 040274 69 RTDLMRVNPFN---GVVSLGHSGGTVTMWKPTTSALLI 103 (359)
Q Consensus 69 ~v~~l~~sp~~---~~l~tg~~dg~v~lwd~~~~~~~~ 103 (359)
.+.-.+|||+. ..|..-++|.++++||....+.++
T Consensus 167 tl~Qa~WHP~S~~D~hL~iL~sdnviRiy~lS~~tely 204 (741)
T KOG4460|consen 167 TLKQAAWHPSSILDPHLVLLTSDNVIRIYSLSEPTELY 204 (741)
T ss_pred eeeeccccCCccCCceEEEEecCcEEEEEecCCcchhh
Confidence 45666788854 566667778888888877655443
No 495
>PF11715 Nup160: Nucleoporin Nup120/160; InterPro: IPR021717 Nup120 is conserved from fungi to plants to humans, and is homologous with the Nup160 of vertebrates. The nuclear core complex, or NPC, mediates macromolecular transport across the nuclear envelope. Deletion of the NUP120 gene causes clustering of NPCs at one side of the nuclear envelope, moderate nucleolar fragmentation and slower cell growth []. The vertebrate NPC is estimated to contain between 30 and 60 different proteins. most of which are not known. Two important ones in creating the nucleoporin basket are Nup98 and Nup153, and Nup120, in conjunction with Nup 133, interacts with these two and itself plays a role in mRNA export []. Nup160, Nup133, Nup96, and Nup107 are all targets of phosphorylation. The phosphorylation sites are clustered mainly at the N-terminal regions of these proteins, which are predicted to be natively disordered. The entire Nup107-160 subcomplex is stable throughout the cell cycle, thus it seems unlikely that phosphorylation affects interactions within the Nup107-160 subcomplex, but rather that it regulates the association of the subcomplex with the NPC and other proteins []. ; PDB: 3F7F_D 3H7N_D 3HXR_A.
Probab=73.98 E-value=7.4 Score=38.34 Aligned_cols=38 Identities=13% Similarity=0.133 Sum_probs=28.8
Q ss_pred eeEEEEcC----CCCEEEEEeCCCeEEEEeCCCCcceEEeec
Q 040274 70 TDLMRVNP----FNGVVSLGHSGGTVTMWKPTTSALLIKMLY 107 (359)
Q Consensus 70 v~~l~~sp----~~~~l~tg~~dg~v~lwd~~~~~~~~~~~~ 107 (359)
+.++++++ +..++++.+.|+.+++||+.++.++.++..
T Consensus 217 ~~~~~~~~~~~~~~~~l~tl~~D~~LRiW~l~t~~~~~~~~~ 258 (547)
T PF11715_consen 217 AASLAVSSSEINDDTFLFTLSRDHTLRIWSLETGQCLATIDL 258 (547)
T ss_dssp EEEEEE-----ETTTEEEEEETTSEEEEEETTTTCEEEEEET
T ss_pred cceEEEecceeCCCCEEEEEeCCCeEEEEECCCCeEEEEecc
Confidence 34455555 667999999999999999999998766543
No 496
>TIGR03547 muta_rot_YjhT mutatrotase, YjhT family. Members of this protein family contain multiple copies of the beta-propeller-forming Kelch repeat. All are full-length homologs to YjhT of Escherichia coli, which has been identified as a mutarotase for sialic acid. This protein improves bacterial ability to obtain host sialic acid, and thus serves as a virulence factor. Some bacteria carry what appears to be a cyclically permuted homolog of this protein.
Probab=73.81 E-value=72 Score=29.14 Aligned_cols=41 Identities=20% Similarity=0.254 Sum_probs=19.7
Q ss_pred CeEEEEeCCCCcceE--EeecCCCCeEEEEEecCCCEEEEecCC
Q 040274 89 GTVTMWKPTTSALLI--KMLYHQGPVSALAFHPNGHLMATTGKE 130 (359)
Q Consensus 89 g~v~lwd~~~~~~~~--~~~~h~~~v~~l~~~p~g~~l~s~~~d 130 (359)
..|.+||+.+.+-.. .+......-.+++ .-++.+++.|+.+
T Consensus 168 ~~v~~YDp~t~~W~~~~~~p~~~r~~~~~~-~~~~~iyv~GG~~ 210 (346)
T TIGR03547 168 KNVLSYDPSTNQWRNLGENPFLGTAGSAIV-HKGNKLLLINGEI 210 (346)
T ss_pred ceEEEEECCCCceeECccCCCCcCCCceEE-EECCEEEEEeeee
Confidence 468888987654322 2211011112222 3356777777653
No 497
>PF01011 PQQ: PQQ enzyme repeat family.; InterPro: IPR002372 Pyrrolo-quinoline quinone (PQQ) is a redox coenzyme, which serves as a cofactor for a number of enzymes (quinoproteins) and particularly for some bacterial dehydrogenases [, ]. A number of bacterial quinoproteins belong to this family. Enzymes in this group have repeats of a beta propeller.; PDB: 1H4I_C 1H4J_E 1W6S_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A 1G72_A ....
Probab=72.55 E-value=10 Score=22.01 Aligned_cols=27 Identities=22% Similarity=0.249 Sum_probs=22.8
Q ss_pred EEEEEeCCCeEEEEeCCCCcceEEeec
Q 040274 81 VVSLGHSGGTVTMWKPTTSALLIKMLY 107 (359)
Q Consensus 81 ~l~tg~~dg~v~lwd~~~~~~~~~~~~ 107 (359)
.++.++.||.|.-.|..+|+.+..+..
T Consensus 2 ~v~~~~~~g~l~AlD~~TG~~~W~~~~ 28 (38)
T PF01011_consen 2 RVYVGTPDGYLYALDAKTGKVLWKFQT 28 (38)
T ss_dssp EEEEETTTSEEEEEETTTTSEEEEEES
T ss_pred EEEEeCCCCEEEEEECCCCCEEEeeeC
Confidence 456678999999999999999888763
No 498
>KOG1520 consensus Predicted alkaloid synthase/Surface mucin Hemomucin [General function prediction only]
Probab=71.48 E-value=86 Score=29.04 Aligned_cols=57 Identities=2% Similarity=-0.110 Sum_probs=32.7
Q ss_pred CCcEEEEcCCCCCccccccccccCCCCcceeEEEEccCCCEEEEEeCC--CeEEEEEcCCCCCce
Q 040274 167 GSFAQILGDFSGSHNYSRYMGNSMVKGYQIGKVSFRPYEDVLGIGHSM--GWSGILVPRSSEPNF 229 (359)
Q Consensus 167 d~~i~v~d~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~g~~d--g~~~i~~~gs~~~~~ 229 (359)
+|.+.-||..+. ....+...-. -.+.++.|||+++++++-.. ...++|+.|..-++.
T Consensus 198 ~GRl~~YD~~tK--~~~VLld~L~----F~NGlaLS~d~sfvl~~Et~~~ri~rywi~g~k~gt~ 256 (376)
T KOG1520|consen 198 TGRLFRYDPSTK--VTKVLLDGLY----FPNGLALSPDGSFVLVAETTTARIKRYWIKGPKAGTS 256 (376)
T ss_pred ccceEEecCccc--chhhhhhccc----ccccccCCCCCCEEEEEeeccceeeeeEecCCccCch
Confidence 356666764332 2222222211 35678999999998876543 345778777654443
No 499
>KOG1897 consensus Damage-specific DNA binding complex, subunit DDB1 [Replication, recombination and repair]
Probab=71.08 E-value=1.4e+02 Score=31.35 Aligned_cols=120 Identities=13% Similarity=0.004 Sum_probs=63.1
Q ss_pred EEECCCCCEEEEecc---------ceeEEEEcCCCCEEEEEeCCCeEEEEeCCCCcceEEee--cCCCCeEEEEEecC--
Q 040274 54 WILPSSGRYMAVAGR---------RTDLMRVNPFNGVVSLGHSGGTVTMWKPTTSALLIKML--YHQGPVSALAFHPN-- 120 (359)
Q Consensus 54 l~~spdg~~l~~~~~---------~v~~l~~sp~~~~l~tg~~dg~v~lwd~~~~~~~~~~~--~h~~~v~~l~~~p~-- 120 (359)
+..++++-.|+.+.. .+++...+.+...++.++.++.+...++..+. +.... .....|.|+.++|-
T Consensus 465 vQvTs~~iRl~ss~~~~~~W~~p~~~ti~~~~~n~sqVvvA~~~~~l~y~~i~~~~-l~e~~~~~~e~evaCLDisp~~d 543 (1096)
T KOG1897|consen 465 VQVTSNSIRLVSSAGLRSEWRPPGKITIGVVSANASQVVVAGGGLALFYLEIEDGG-LREVSHKEFEYEVACLDISPLGD 543 (1096)
T ss_pred EEEecccEEEEcchhhhhcccCCCceEEEEEeecceEEEEecCccEEEEEEeeccc-eeeeeeheecceeEEEecccCCC
Confidence 444555555554431 33444444444566666666666666666544 22221 23567899999983
Q ss_pred C-C---EEEEecCCCeEEEE-EcCCCeeeEee-------cCCceeEEEcCCC--cEEEEcCCcEEEEc
Q 040274 121 G-H---LMATTGKECKIKIW-DLRKYEVLQTL-------TGHAKTLDFSQKG--LLAVGTGSFAQILG 174 (359)
Q Consensus 121 g-~---~l~s~~~d~~i~vw-d~~~~~~~~~~-------~~~v~~~~~s~~g--l~~~~~d~~i~v~d 174 (359)
+ + +++.|..+..+.+. -......+... +..+.-.++-.|+ ++++..||.+..|.
T Consensus 544 ~~~~s~~~aVG~Ws~~~~~l~~~pd~~~~~~~~l~~~~iPRSIl~~~~e~d~~yLlvalgdG~l~~fv 611 (1096)
T KOG1897|consen 544 APNKSRLLAVGLWSDISMILTFLPDLILITHEQLSGEIIPRSILLTTFEGDIHYLLVALGDGALLYFV 611 (1096)
T ss_pred CCCcceEEEEEeecceEEEEEECCCcceeeeeccCCCccchheeeEEeeccceEEEEEcCCceEEEEE
Confidence 2 2 67777776654433 22223222221 2234444455544 66677788776554
No 500
>PLN02193 nitrile-specifier protein
Probab=70.95 E-value=97 Score=29.90 Aligned_cols=63 Identities=8% Similarity=0.118 Sum_probs=31.1
Q ss_pred CCEEEEEeCC-----CeEEEEeCCCCcceEEeec---CC-CCeEEEEEecCCCEEEEecCCC-----eEEEEEcCCCe
Q 040274 79 NGVVSLGHSG-----GTVTMWKPTTSALLIKMLY---HQ-GPVSALAFHPNGHLMATTGKEC-----KIKIWDLRKYE 142 (359)
Q Consensus 79 ~~~l~tg~~d-----g~v~lwd~~~~~~~~~~~~---h~-~~v~~l~~~p~g~~l~s~~~d~-----~i~vwd~~~~~ 142 (359)
+.+++.|+.+ ..+.+||+.+.+....-.. .. ..-.+++. -++.+++.|+.++ .+..||+.+.+
T Consensus 229 ~~lYvfGG~~~~~~~ndv~~yD~~t~~W~~l~~~~~~P~~R~~h~~~~-~~~~iYv~GG~~~~~~~~~~~~yd~~t~~ 305 (470)
T PLN02193 229 STLYVFGGRDASRQYNGFYSFDTTTNEWKLLTPVEEGPTPRSFHSMAA-DEENVYVFGGVSATARLKTLDSYNIVDKK 305 (470)
T ss_pred CEEEEECCCCCCCCCccEEEEECCCCEEEEcCcCCCCCCCccceEEEE-ECCEEEEECCCCCCCCcceEEEEECCCCE
Confidence 3445555544 3577888876543221111 01 11122222 2456667776543 46778887654
Done!