Query 036605
Match_columns 340
No_of_seqs 548 out of 3722
Neff 11.0
Searched_HMMs 46136
Date Fri Mar 29 03:43:53 2013
Command hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/036605.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/036605hhsearch_cdd -cpu 12 -v 0
No Hit Prob E-value P-value Score SS Cols Query HMM Template HMM
1 KOG0272 U4/U6 small nuclear ri 100.0 2.6E-37 5.6E-42 251.7 17.9 225 1-247 201-429 (459)
2 KOG0272 U4/U6 small nuclear ri 100.0 5.2E-36 1.1E-40 244.2 14.6 211 1-234 245-458 (459)
3 KOG0271 Notchless-like WD40 re 100.0 5.1E-34 1.1E-38 230.0 21.7 223 1-246 141-407 (480)
4 KOG0263 Transcription initiati 100.0 5.6E-34 1.2E-38 249.0 21.2 214 5-241 439-654 (707)
5 KOG0315 G-protein beta subunit 100.0 3E-32 6.5E-37 208.1 22.4 222 1-246 65-298 (311)
6 KOG0279 G protein beta subunit 100.0 4.7E-32 1E-36 210.2 23.2 219 4-247 50-273 (315)
7 KOG0279 G protein beta subunit 100.0 6.1E-32 1.3E-36 209.6 23.2 216 1-236 89-313 (315)
8 KOG0271 Notchless-like WD40 re 100.0 4.3E-32 9.4E-37 218.9 21.0 226 1-245 183-448 (480)
9 KOG0266 WD40 repeat-containing 100.0 7.8E-31 1.7E-35 233.4 29.6 227 1-247 185-420 (456)
10 KOG0291 WD40-repeat-containing 100.0 6E-31 1.3E-35 228.8 24.8 219 1-242 334-556 (893)
11 KOG0286 G-protein beta subunit 100.0 1.4E-30 3.1E-35 203.3 22.0 196 19-234 143-343 (343)
12 KOG0286 G-protein beta subunit 100.0 1.6E-29 3.5E-34 197.4 23.8 221 1-244 81-311 (343)
13 KOG0295 WD40 repeat-containing 100.0 5.6E-31 1.2E-35 211.2 16.0 232 1-255 134-383 (406)
14 KOG0263 Transcription initiati 100.0 4.5E-30 9.7E-35 224.7 21.4 216 9-247 370-618 (707)
15 KOG0316 Conserved WD40 repeat- 100.0 1.8E-29 3.9E-34 191.5 19.8 223 1-246 43-267 (307)
16 KOG0282 mRNA splicing factor [ 100.0 1.5E-30 3.3E-35 215.8 15.0 215 19-246 212-472 (503)
17 PTZ00421 coronin; Provisional 100.0 3.5E-28 7.6E-33 215.9 28.6 207 19-241 73-295 (493)
18 KOG0266 WD40 repeat-containing 100.0 1E-28 2.2E-33 219.9 25.1 210 19-247 157-375 (456)
19 KOG0285 Pleiotropic regulator 100.0 3.7E-29 8E-34 200.5 19.6 217 1-242 177-395 (460)
20 KOG0285 Pleiotropic regulator 100.0 2.5E-29 5.5E-34 201.4 18.3 209 18-246 148-358 (460)
21 KOG0273 Beta-transducin family 100.0 3.9E-29 8.5E-34 206.8 19.4 205 22-246 236-492 (524)
22 KOG0284 Polyadenylation factor 100.0 4.5E-30 9.7E-35 208.8 13.3 210 19-246 136-347 (464)
23 PTZ00420 coronin; Provisional 100.0 8.6E-28 1.9E-32 214.5 29.1 204 19-238 72-295 (568)
24 KOG0315 G-protein beta subunit 100.0 2E-28 4.3E-33 187.3 21.3 216 1-238 24-247 (311)
25 KOG0281 Beta-TrCP (transducin 100.0 3.1E-30 6.6E-35 206.1 11.3 209 1-242 221-434 (499)
26 KOG0284 Polyadenylation factor 100.0 3.8E-30 8.3E-35 209.2 11.8 203 18-237 177-381 (464)
27 KOG0294 WD40 repeat-containing 100.0 1.4E-27 3E-32 188.5 25.1 203 19-241 41-286 (362)
28 KOG0273 Beta-transducin family 100.0 2.6E-28 5.6E-33 202.0 21.1 206 7-236 266-523 (524)
29 KOG0645 WD40 repeat protein [G 100.0 1.6E-27 3.5E-32 184.4 24.0 201 19-236 12-225 (312)
30 KOG0265 U5 snRNP-specific prot 100.0 1.6E-27 3.4E-32 187.0 22.7 223 18-253 44-313 (338)
31 KOG0295 WD40 repeat-containing 100.0 7.3E-28 1.6E-32 193.4 19.4 198 19-235 191-405 (406)
32 KOG0276 Vesicle coat complex C 100.0 9.4E-28 2E-32 205.1 19.6 222 1-245 39-266 (794)
33 cd00200 WD40 WD40 domain, foun 100.0 5.9E-26 1.3E-30 191.0 29.5 219 1-242 35-255 (289)
34 KOG0293 WD40 repeat-containing 100.0 3.8E-27 8.2E-32 192.2 19.5 245 19-294 267-514 (519)
35 KOG0275 Conserved WD40 repeat- 100.0 1.6E-28 3.6E-33 194.7 9.8 213 18-242 210-473 (508)
36 KOG0319 WD40-repeat-containing 100.0 2.7E-27 5.8E-32 205.8 18.0 202 18-237 408-620 (775)
37 KOG0276 Vesicle coat complex C 100.0 2.1E-26 4.6E-31 196.9 22.8 244 19-294 11-258 (794)
38 KOG0278 Serine/threonine kinas 100.0 1.7E-27 3.6E-32 182.4 14.2 215 1-240 85-301 (334)
39 cd00200 WD40 WD40 domain, foun 100.0 8.2E-26 1.8E-30 190.1 25.3 211 1-234 77-289 (289)
40 KOG0292 Vesicle coat complex C 100.0 5.5E-27 1.2E-31 207.6 18.2 223 1-244 35-288 (1202)
41 KOG0296 Angio-associated migra 100.0 1E-25 2.2E-30 181.2 23.3 212 1-236 90-398 (399)
42 KOG0282 mRNA splicing factor [ 100.0 1.6E-27 3.4E-32 198.0 13.2 211 1-234 241-503 (503)
43 KOG0645 WD40 repeat protein [G 99.9 2.7E-25 5.9E-30 172.1 24.2 195 18-237 58-262 (312)
44 KOG0281 Beta-TrCP (transducin 99.9 1.6E-27 3.4E-32 190.7 10.6 208 1-238 261-479 (499)
45 PLN00181 protein SPA1-RELATED; 99.9 3E-25 6.5E-30 211.6 27.9 213 1-235 559-792 (793)
46 KOG0291 WD40-repeat-containing 99.9 3.7E-25 8E-30 193.1 23.6 223 1-242 376-618 (893)
47 KOG0319 WD40-repeat-containing 99.9 2.6E-25 5.7E-30 193.5 22.2 210 19-247 363-588 (775)
48 KOG0316 Conserved WD40 repeat- 99.9 8.9E-25 1.9E-29 166.1 21.9 239 19-294 15-258 (307)
49 KOG0310 Conserved WD40 repeat- 99.9 1.4E-25 3E-30 186.7 18.9 203 19-242 66-274 (487)
50 KOG0305 Anaphase promoting com 99.9 1.9E-25 4.1E-30 192.2 20.0 218 1-238 201-463 (484)
51 KOG0289 mRNA splicing factor [ 99.9 3.4E-25 7.3E-30 182.0 20.3 214 1-236 245-462 (506)
52 KOG0283 WD40 repeat-containing 99.9 5.1E-25 1.1E-29 194.7 22.7 244 18-294 264-577 (712)
53 KOG0296 Angio-associated migra 99.9 2.1E-24 4.6E-29 173.7 23.8 210 19-246 62-273 (399)
54 KOG0274 Cdc4 and related F-box 99.9 6.5E-25 1.4E-29 195.5 22.5 216 1-246 232-451 (537)
55 KOG1446 Histone H3 (Lys4) meth 99.9 5.9E-24 1.3E-28 168.3 24.4 224 1-246 40-272 (311)
56 KOG0643 Translation initiation 99.9 5.5E-24 1.2E-28 164.7 21.9 204 19-242 8-226 (327)
57 KOG0306 WD40-repeat-containing 99.9 3.5E-24 7.6E-29 186.9 23.2 223 1-248 398-634 (888)
58 KOG0310 Conserved WD40 repeat- 99.9 1.1E-24 2.3E-29 181.4 19.0 209 2-235 95-308 (487)
59 KOG0640 mRNA cleavage stimulat 99.9 4.8E-25 1.1E-29 174.0 15.1 207 19-242 110-341 (430)
60 KOG0292 Vesicle coat complex C 99.9 1.3E-24 2.9E-29 192.7 19.4 204 20-237 8-237 (1202)
61 PLN00181 protein SPA1-RELATED; 99.9 1.3E-23 2.8E-28 200.5 27.8 202 21-238 532-740 (793)
62 KOG0277 Peroxisomal targeting 99.9 8.5E-25 1.8E-29 168.0 15.2 215 1-235 87-308 (311)
63 KOG0293 WD40 repeat-containing 99.9 9.8E-25 2.1E-29 178.2 15.5 215 1-237 295-514 (519)
64 KOG0313 Microtubule binding pr 99.9 4.7E-24 1E-28 172.5 18.7 198 19-236 191-418 (423)
65 KOG0275 Conserved WD40 repeat- 99.9 1.5E-25 3.2E-30 178.0 9.0 216 1-234 239-507 (508)
66 KOG1407 WD40 repeat protein [F 99.9 1.5E-23 3.3E-28 161.7 19.8 220 1-242 46-267 (313)
67 KOG0283 WD40 repeat-containing 99.9 3.9E-24 8.5E-29 189.1 18.9 205 9-237 361-577 (712)
68 KOG0277 Peroxisomal targeting 99.9 6.1E-24 1.3E-28 163.3 17.4 203 20-237 59-266 (311)
69 KOG0318 WD40 repeat stress pro 99.9 1.7E-23 3.8E-28 175.8 20.9 216 5-242 47-271 (603)
70 KOG0772 Uncharacterized conser 99.9 5.2E-24 1.1E-28 178.6 17.6 242 19-290 165-484 (641)
71 PTZ00421 coronin; Provisional 99.9 6.1E-23 1.3E-27 182.6 24.2 199 22-239 21-248 (493)
72 KOG0274 Cdc4 and related F-box 99.9 2.5E-23 5.3E-28 185.4 20.9 212 1-244 275-490 (537)
73 KOG0265 U5 snRNP-specific prot 99.9 2E-23 4.4E-28 164.0 17.8 211 1-234 116-336 (338)
74 KOG0318 WD40 repeat stress pro 99.9 2.3E-22 4.9E-27 169.2 24.6 212 6-242 136-356 (603)
75 KOG0643 Translation initiation 99.9 9.6E-23 2.1E-27 157.8 20.1 170 1-186 36-220 (327)
76 PTZ00420 coronin; Provisional 99.9 2.5E-22 5.5E-27 179.6 24.8 181 48-237 50-249 (568)
77 KOG0973 Histone transcription 99.9 2.3E-22 4.9E-27 182.5 23.8 157 18-185 10-200 (942)
78 KOG0646 WD40 repeat protein [G 99.9 6.4E-23 1.4E-27 170.1 18.6 211 20-245 80-316 (476)
79 KOG0306 WD40-repeat-containing 99.9 3.3E-23 7.1E-28 181.0 17.7 215 1-237 438-665 (888)
80 KOG0313 Microtubule binding pr 99.9 1.6E-22 3.5E-27 163.7 20.2 223 1-242 129-383 (423)
81 KOG0973 Histone transcription 99.9 1.7E-22 3.6E-27 183.4 22.4 202 19-237 67-356 (942)
82 KOG0264 Nucleosome remodeling 99.9 1.1E-22 2.4E-27 168.2 18.5 207 19-236 175-404 (422)
83 KOG0300 WD40 repeat-containing 99.9 7.7E-23 1.7E-27 162.2 16.5 215 1-239 174-431 (481)
84 KOG0647 mRNA export protein (c 99.9 1.4E-21 3.1E-26 153.9 23.1 210 19-242 25-287 (347)
85 KOG0269 WD40 repeat-containing 99.9 1.8E-23 4E-28 183.0 13.7 217 1-237 114-341 (839)
86 KOG0289 mRNA splicing factor [ 99.9 3.8E-22 8.3E-27 164.1 18.7 202 22-242 220-425 (506)
87 KOG0299 U3 snoRNP-associated p 99.9 1.8E-22 4E-27 167.1 16.7 202 19-238 200-412 (479)
88 KOG0267 Microtubule severing p 99.9 7.1E-24 1.5E-28 184.3 8.7 209 19-246 26-236 (825)
89 KOG0640 mRNA cleavage stimulat 99.9 1.7E-22 3.7E-27 159.7 14.9 162 9-186 164-335 (430)
90 KOG0278 Serine/threonine kinas 99.9 1.2E-22 2.6E-27 155.9 13.2 156 19-186 12-173 (334)
91 KOG0300 WD40 repeat-containing 99.9 1.7E-22 3.6E-27 160.3 14.3 202 19-239 146-389 (481)
92 KOG0641 WD40 repeat protein [G 99.9 7.4E-21 1.6E-25 144.2 22.5 203 18-236 86-349 (350)
93 KOG0308 Conserved WD40 repeat- 99.9 1.2E-22 2.7E-27 174.7 14.5 201 19-238 71-287 (735)
94 KOG1446 Histone H3 (Lys4) meth 99.9 5.4E-20 1.2E-24 146.0 28.2 207 20-242 13-223 (311)
95 KOG0267 Microtubule severing p 99.9 1.5E-23 3.2E-28 182.3 8.5 191 19-228 68-260 (825)
96 KOG0288 WD40 repeat protein Ti 99.9 1.2E-22 2.7E-27 166.0 13.2 207 1-233 245-458 (459)
97 KOG2096 WD40 repeat protein [G 99.9 4.7E-21 1E-25 152.1 21.0 211 19-246 84-370 (420)
98 KOG0299 U3 snoRNP-associated p 99.9 1.1E-21 2.5E-26 162.5 18.0 204 19-242 140-362 (479)
99 KOG0288 WD40 repeat protein Ti 99.9 2.3E-22 5E-27 164.4 13.6 216 1-242 201-423 (459)
100 KOG1332 Vesicle coat complex C 99.9 1.1E-21 2.4E-26 150.1 16.4 210 8-237 47-287 (299)
101 KOG0268 Sof1-like rRNA process 99.9 2.2E-22 4.8E-27 162.0 13.2 209 18-246 63-355 (433)
102 KOG0772 Uncharacterized conser 99.9 5.5E-22 1.2E-26 166.5 14.3 204 18-237 265-488 (641)
103 KOG1407 WD40 repeat protein [F 99.9 1E-20 2.2E-25 146.2 20.0 210 1-236 91-311 (313)
104 KOG0321 WD40 repeat-containing 99.9 8.5E-21 1.8E-25 163.2 21.6 251 19-298 98-397 (720)
105 KOG0264 Nucleosome remodeling 99.9 3.2E-21 7E-26 159.6 18.1 204 19-237 122-348 (422)
106 KOG0301 Phospholipase A2-activ 99.9 3.1E-21 6.7E-26 167.3 18.1 203 1-237 85-289 (745)
107 KOG4547 WD40 repeat-containing 99.9 2.9E-20 6.3E-25 159.0 23.3 239 1-241 19-274 (541)
108 KOG0302 Ribosome Assembly prot 99.9 6.1E-21 1.3E-25 154.5 18.1 205 19-235 209-437 (440)
109 KOG4283 Transcription-coupled 99.9 8.9E-21 1.9E-25 149.0 18.3 210 18-240 40-280 (397)
110 KOG1539 WD repeat protein [Gen 99.9 1.5E-20 3.2E-25 166.3 19.8 198 20-237 447-649 (910)
111 KOG1273 WD40 repeat protein [G 99.9 1.1E-20 2.5E-25 149.7 17.2 210 24-246 26-290 (405)
112 KOG4328 WD40 protein [Function 99.9 2.4E-20 5.2E-25 154.6 19.6 206 19-236 184-399 (498)
113 KOG1036 Mitotic spindle checkp 99.9 2.4E-20 5.1E-25 147.5 18.7 225 2-246 40-272 (323)
114 KOG0641 WD40 repeat protein [G 99.9 3.4E-19 7.5E-24 135.2 24.1 217 20-252 31-277 (350)
115 KOG0301 Phospholipase A2-activ 99.9 2.3E-20 5E-25 162.0 19.3 193 19-236 55-249 (745)
116 KOG0294 WD40 repeat-containing 99.9 2.6E-20 5.7E-25 147.6 17.8 177 1-191 67-286 (362)
117 KOG1332 Vesicle coat complex C 99.9 8.3E-21 1.8E-25 145.4 13.6 202 19-236 9-241 (299)
118 KOG0269 WD40 repeat-containing 99.9 3.1E-21 6.7E-26 169.2 12.5 185 44-237 102-297 (839)
119 KOG0305 Anaphase promoting com 99.9 1.1E-20 2.4E-25 162.9 15.6 155 19-185 299-460 (484)
120 KOG0270 WD40 repeat-containing 99.9 2.5E-20 5.5E-25 153.9 16.9 208 18-240 240-453 (463)
121 KOG0639 Transducin-like enhanc 99.9 3.5E-21 7.5E-26 161.4 11.8 209 1-235 491-703 (705)
122 KOG2919 Guanine nucleotide-bin 99.9 9.2E-20 2E-24 145.1 17.9 236 22-277 105-358 (406)
123 KOG0646 WD40 repeat protein [G 99.9 4.1E-20 8.9E-25 153.6 16.5 179 1-197 107-316 (476)
124 KOG1408 WD40 repeat protein [F 99.8 4.9E-20 1.1E-24 160.6 16.0 203 19-237 499-714 (1080)
125 KOG0308 Conserved WD40 repeat- 99.8 6.6E-20 1.4E-24 158.1 16.4 215 1-237 99-328 (735)
126 TIGR03866 PQQ_ABC_repeats PQQ- 99.8 4.9E-18 1.1E-22 144.6 27.5 221 1-242 15-243 (300)
127 KOG1036 Mitotic spindle checkp 99.8 3.3E-18 7.2E-23 135.4 23.9 196 20-238 12-209 (323)
128 KOG1274 WD40 repeat protein [G 99.8 3.8E-19 8.1E-24 159.1 20.3 198 20-237 55-263 (933)
129 KOG0303 Actin-binding protein 99.8 3.6E-19 7.9E-24 145.2 18.5 203 18-238 78-296 (472)
130 TIGR03866 PQQ_ABC_repeats PQQ- 99.8 5.5E-18 1.2E-22 144.2 26.9 216 1-242 57-285 (300)
131 KOG2055 WD40 repeat protein [G 99.8 4.9E-19 1.1E-23 147.1 16.0 219 1-236 284-512 (514)
132 KOG0302 Ribosome Assembly prot 99.8 1.2E-18 2.6E-23 141.3 17.8 204 20-237 150-379 (440)
133 KOG1274 WD40 repeat protein [G 99.8 7.9E-18 1.7E-22 150.7 24.4 212 19-246 11-228 (933)
134 KOG2055 WD40 repeat protein [G 99.8 2.3E-18 5.1E-23 143.1 19.0 206 22-246 214-427 (514)
135 KOG2048 WD40 repeat protein [G 99.8 8.4E-18 1.8E-22 145.9 23.2 206 21-243 25-240 (691)
136 KOG1273 WD40 repeat protein [G 99.8 1.9E-18 4E-23 137.3 16.4 218 1-242 49-328 (405)
137 KOG0647 mRNA export protein (c 99.8 4.5E-18 9.7E-23 134.3 17.9 200 1-223 54-310 (347)
138 KOG2048 WD40 repeat protein [G 99.8 1.9E-17 4E-22 143.8 23.4 215 1-238 51-277 (691)
139 KOG1408 WD40 repeat protein [F 99.8 4.6E-18 1E-22 148.5 19.5 209 22-246 460-681 (1080)
140 KOG0307 Vesicle coat complex C 99.8 9.9E-20 2.2E-24 166.4 9.7 204 19-239 114-330 (1049)
141 KOG0650 WD40 repeat nucleolar 99.8 5.9E-18 1.3E-22 145.0 19.2 201 19-238 398-682 (733)
142 KOG1188 WD40 repeat protein [G 99.8 4.1E-18 8.8E-23 136.7 16.6 193 44-241 42-247 (376)
143 KOG0639 Transducin-like enhanc 99.8 1.9E-18 4.2E-23 145.1 14.6 201 21-242 465-669 (705)
144 KOG1539 WD repeat protein [Gen 99.8 2.7E-17 5.9E-22 145.9 22.1 225 1-243 228-613 (910)
145 KOG0270 WD40 repeat-containing 99.8 1.1E-17 2.5E-22 138.4 17.5 210 22-240 174-408 (463)
146 KOG4378 Nuclear protein COP1 [ 99.8 3.4E-18 7.4E-23 143.4 14.5 184 44-238 93-282 (673)
147 KOG2110 Uncharacterized conser 99.8 4.5E-16 9.9E-21 126.3 25.9 152 22-186 88-248 (391)
148 KOG1063 RNA polymerase II elon 99.8 1.6E-17 3.5E-22 144.5 17.8 206 18-238 358-650 (764)
149 KOG1034 Transcriptional repres 99.8 5.1E-18 1.1E-22 135.5 13.3 220 8-240 78-341 (385)
150 KOG1007 WD repeat protein TSSC 99.8 1.7E-17 3.6E-22 130.4 15.5 204 19-237 61-290 (370)
151 KOG4283 Transcription-coupled 99.8 7.8E-17 1.7E-21 127.1 18.3 157 18-185 98-275 (397)
152 KOG1034 Transcriptional repres 99.8 5.8E-18 1.3E-22 135.2 11.7 214 2-236 120-383 (385)
153 KOG0268 Sof1-like rRNA process 99.8 3E-18 6.4E-23 138.5 10.2 170 1-185 171-344 (433)
154 KOG0307 Vesicle coat complex C 99.8 3.4E-18 7.3E-23 156.5 11.6 210 21-242 64-290 (1049)
155 KOG1587 Cytoplasmic dynein int 99.8 7.7E-17 1.7E-21 143.2 19.5 217 1-237 226-517 (555)
156 KOG2919 Guanine nucleotide-bin 99.8 2.8E-17 6E-22 131.1 14.8 173 1-186 137-327 (406)
157 KOG2445 Nuclear pore complex c 99.8 4.5E-16 9.9E-21 123.4 21.2 206 18-237 10-257 (361)
158 KOG4378 Nuclear protein COP1 [ 99.8 4.5E-17 9.7E-22 136.8 15.9 190 1-209 105-299 (673)
159 KOG2096 WD40 repeat protein [G 99.7 5.5E-17 1.2E-21 129.2 14.4 167 1-184 213-400 (420)
160 KOG1523 Actin-related protein 99.7 4.4E-16 9.5E-21 124.2 18.6 206 20-239 9-239 (361)
161 KOG1063 RNA polymerase II elon 99.7 9.3E-17 2E-21 139.9 15.9 206 18-236 522-763 (764)
162 KOG4328 WD40 protein [Function 99.7 1.8E-16 3.9E-21 131.9 16.8 209 19-242 232-456 (498)
163 KOG2106 Uncharacterized conser 99.7 1.4E-15 3.1E-20 128.1 22.3 210 2-237 227-478 (626)
164 KOG1538 Uncharacterized conser 99.7 3.1E-16 6.7E-21 136.4 18.7 211 1-237 37-294 (1081)
165 KOG2445 Nuclear pore complex c 99.7 9.9E-16 2.2E-20 121.5 19.6 220 1-238 39-320 (361)
166 KOG0321 WD40 repeat-containing 99.7 2.3E-16 5.1E-21 136.2 16.8 196 44-241 66-306 (720)
167 KOG1009 Chromatin assembly com 99.7 1.3E-16 2.9E-21 130.8 13.9 157 19-185 11-194 (434)
168 KOG0642 Cell-cycle nuclear pro 99.7 3.5E-16 7.5E-21 133.4 15.3 200 19-238 292-563 (577)
169 KOG2106 Uncharacterized conser 99.7 3.8E-15 8.3E-20 125.6 21.2 214 1-241 271-526 (626)
170 KOG0649 WD40 repeat protein [G 99.7 2.5E-15 5.4E-20 115.6 18.2 198 23-242 12-241 (325)
171 KOG1524 WD40 repeat-containing 99.7 2E-16 4.3E-21 134.2 13.4 193 31-233 64-283 (737)
172 KOG1445 Tumor-specific antigen 99.7 1.5E-16 3.2E-21 137.5 12.7 204 20-237 626-845 (1012)
173 KOG2394 WD40 protein DMR-N9 [G 99.7 3.6E-16 7.8E-21 132.6 14.1 136 21-165 219-384 (636)
174 KOG2110 Uncharacterized conser 99.7 8.8E-15 1.9E-19 118.9 21.3 185 44-239 58-251 (391)
175 KOG1007 WD repeat protein TSSC 99.7 3.4E-15 7.5E-20 117.5 18.1 202 21-236 123-361 (370)
176 KOG0771 Prolactin regulatory e 99.7 4.6E-16 9.9E-21 128.4 13.7 194 25-237 148-355 (398)
177 PRK01742 tolB translocation pr 99.7 4.6E-15 9.9E-20 132.1 20.4 203 1-236 188-401 (429)
178 COG2319 FOG: WD40 repeat [Gene 99.7 7.1E-14 1.5E-18 124.1 27.1 217 1-239 138-362 (466)
179 PRK11028 6-phosphogluconolacto 99.7 6.7E-14 1.5E-18 120.8 25.2 197 23-236 81-304 (330)
180 PRK05137 tolB translocation pr 99.7 6.9E-14 1.5E-18 125.0 25.8 197 19-238 199-414 (435)
181 KOG0303 Actin-binding protein 99.7 4.1E-15 8.8E-20 121.8 15.7 155 19-185 129-293 (472)
182 KOG0290 Conserved WD40 repeat- 99.7 9.6E-15 2.1E-19 115.2 16.9 159 18-187 147-319 (364)
183 KOG0290 Conserved WD40 repeat- 99.7 1.6E-14 3.4E-19 114.0 17.6 211 18-240 93-322 (364)
184 PRK11028 6-phosphogluconolacto 99.7 6.8E-14 1.5E-18 120.7 23.6 202 22-238 35-260 (330)
185 KOG1009 Chromatin assembly com 99.7 3.4E-14 7.3E-19 116.9 20.1 110 13-132 57-182 (434)
186 PF08662 eIF2A: Eukaryotic tra 99.7 3.3E-14 7.1E-19 112.0 19.4 147 25-185 9-178 (194)
187 KOG1310 WD40 repeat protein [G 99.6 2.4E-15 5.2E-20 128.1 13.1 212 19-241 48-308 (758)
188 PRK03629 tolB translocation pr 99.6 1.8E-13 3.8E-18 121.7 25.5 194 20-236 197-406 (429)
189 PRK04922 tolB translocation pr 99.6 1.2E-13 2.6E-18 123.3 24.5 196 19-237 201-412 (433)
190 COG2319 FOG: WD40 repeat [Gene 99.6 2.3E-13 5E-18 120.8 26.5 221 1-242 91-320 (466)
191 KOG1188 WD40 repeat protein [G 99.6 7.3E-15 1.6E-19 118.2 14.0 172 1-186 54-242 (376)
192 KOG1445 Tumor-specific antigen 99.6 6E-15 1.3E-19 127.8 14.4 186 44-238 593-800 (1012)
193 KOG0649 WD40 repeat protein [G 99.6 2E-13 4.3E-18 105.3 20.5 148 22-185 115-273 (325)
194 KOG1272 WD40-repeat-containing 99.6 6.2E-16 1.4E-20 129.0 6.8 203 2-234 156-360 (545)
195 KOG1538 Uncharacterized conser 99.6 2.6E-14 5.6E-19 124.6 17.0 214 23-255 14-234 (1081)
196 KOG0322 G-protein beta subunit 99.6 1.2E-14 2.7E-19 113.0 12.9 158 20-185 149-322 (323)
197 KOG4227 WD40 repeat protein [G 99.6 1.5E-13 3.3E-18 112.8 18.6 161 19-188 54-227 (609)
198 PRK02889 tolB translocation pr 99.6 7.4E-13 1.6E-17 117.9 24.2 194 19-235 193-402 (427)
199 KOG2111 Uncharacterized conser 99.6 1.4E-12 3E-17 104.4 22.7 169 1-187 79-257 (346)
200 KOG0642 Cell-cycle nuclear pro 99.6 4.9E-14 1.1E-18 120.5 15.3 162 9-186 336-561 (577)
201 KOG0650 WD40 repeat nucleolar 99.6 2E-14 4.4E-19 123.7 12.6 200 19-233 519-732 (733)
202 KOG0644 Uncharacterized conser 99.6 1.8E-14 3.9E-19 128.4 10.7 201 19-239 188-471 (1113)
203 KOG1963 WD40 repeat protein [G 99.6 1.7E-12 3.6E-17 116.7 23.0 116 19-145 203-324 (792)
204 KOG0322 G-protein beta subunit 99.6 2.2E-13 4.7E-18 106.2 15.0 213 19-248 12-293 (323)
205 PRK01742 tolB translocation pr 99.5 9.3E-13 2E-17 117.4 19.5 175 51-240 183-365 (429)
206 PF02239 Cytochrom_D1: Cytochr 99.5 7.3E-12 1.6E-16 108.4 24.3 170 1-185 20-201 (369)
207 KOG1517 Guanine nucleotide bin 99.5 2.2E-12 4.8E-17 118.1 21.2 232 1-246 1090-1342(1387)
208 PRK00178 tolB translocation pr 99.5 1.1E-11 2.4E-16 110.9 25.4 195 19-236 196-406 (430)
209 KOG1240 Protein kinase contain 99.5 4.6E-12 9.9E-17 117.7 22.7 217 6-241 1037-1278(1431)
210 KOG1963 WD40 repeat protein [G 99.5 2.7E-12 5.9E-17 115.3 20.7 227 1-242 41-381 (792)
211 TIGR02800 propeller_TolB tol-p 99.5 1.5E-11 3.3E-16 109.8 25.3 194 19-235 187-396 (417)
212 PRK04792 tolB translocation pr 99.5 1.3E-11 2.9E-16 110.2 24.5 196 20-236 216-425 (448)
213 KOG2139 WD40 repeat protein [G 99.5 2.9E-12 6.3E-17 104.3 17.8 197 22-239 99-312 (445)
214 KOG1524 WD40 repeat-containing 99.5 1.7E-13 3.6E-18 116.8 10.6 136 18-166 101-238 (737)
215 KOG0771 Prolactin regulatory e 99.5 4.5E-13 9.7E-18 110.9 12.8 161 77-242 148-317 (398)
216 KOG1310 WD40 repeat protein [G 99.5 1.1E-13 2.5E-18 118.1 9.5 169 66-236 44-231 (758)
217 KOG2394 WD40 protein DMR-N9 [G 99.5 3.3E-13 7.2E-18 114.9 12.0 160 44-209 187-380 (636)
218 KOG2139 WD40 repeat protein [G 99.5 7.1E-12 1.5E-16 102.1 19.1 203 22-236 196-431 (445)
219 PF08662 eIF2A: Eukaryotic tra 99.5 8.9E-12 1.9E-16 98.2 18.2 151 77-242 9-184 (194)
220 PRK02889 tolB translocation pr 99.5 9.1E-12 2E-16 110.9 20.5 178 52-240 176-364 (427)
221 PF02239 Cytochrom_D1: Cytochr 99.5 4.2E-11 9.1E-16 103.7 23.3 189 44-241 8-207 (369)
222 PRK05137 tolB translocation pr 99.5 2E-11 4.3E-16 109.2 22.0 174 52-238 182-368 (435)
223 KOG1272 WD40-repeat-containing 99.5 1.2E-13 2.6E-18 115.5 7.2 195 25-242 133-329 (545)
224 KOG3881 Uncharacterized conser 99.5 1.2E-11 2.6E-16 101.7 17.8 142 44-186 163-320 (412)
225 KOG0644 Uncharacterized conser 99.4 1.7E-14 3.8E-19 128.5 1.2 117 64-186 182-300 (1113)
226 KOG1517 Guanine nucleotide bin 99.4 1.3E-11 2.8E-16 113.3 18.9 201 23-238 1066-1289(1387)
227 KOG4497 Uncharacterized conser 99.4 3.1E-12 6.7E-17 103.0 12.9 186 22-237 49-241 (447)
228 PRK04922 tolB translocation pr 99.4 3E-11 6.6E-16 107.9 19.7 178 52-240 184-372 (433)
229 PRK03629 tolB translocation pr 99.4 1.3E-10 2.8E-15 103.5 23.6 176 53-239 180-366 (429)
230 KOG3881 Uncharacterized conser 99.4 4.8E-11 1E-15 98.2 18.8 189 43-242 116-326 (412)
231 PRK01029 tolB translocation pr 99.4 1.6E-10 3.4E-15 102.6 23.5 203 21-240 184-407 (428)
232 PF10282 Lactonase: Lactonase, 99.4 1.8E-09 4E-14 93.5 28.1 200 23-236 88-322 (345)
233 KOG2321 WD40 repeat protein [G 99.4 1.1E-11 2.3E-16 106.7 13.6 168 3-185 161-342 (703)
234 KOG1334 WD40 repeat protein [G 99.4 1.9E-11 4.1E-16 103.3 14.2 218 18-246 139-434 (559)
235 KOG4227 WD40 repeat protein [G 99.4 3E-11 6.5E-16 99.5 14.8 164 68-237 52-226 (609)
236 KOG1523 Actin-related protein 99.3 8E-11 1.7E-15 94.5 15.4 159 72-235 9-175 (361)
237 KOG2321 WD40 repeat protein [G 99.3 1.5E-10 3.2E-15 99.9 17.8 211 19-246 49-312 (703)
238 KOG0974 WD-repeat protein WDR6 99.3 2.3E-11 5E-16 111.4 13.4 138 44-186 147-288 (967)
239 COG2706 3-carboxymuconate cycl 99.3 3.3E-09 7.1E-14 87.1 24.1 196 25-236 92-321 (346)
240 KOG1064 RAVE (regulator of V-A 99.3 1.7E-11 3.6E-16 117.9 12.4 193 19-242 2206-2404(2439)
241 KOG2111 Uncharacterized conser 99.3 1.4E-09 3E-14 87.5 20.5 176 52-238 75-258 (346)
242 KOG0974 WD-repeat protein WDR6 99.3 1.1E-10 2.4E-15 107.1 15.9 180 44-237 101-289 (967)
243 TIGR02800 propeller_TolB tol-p 99.3 9.3E-10 2E-14 98.3 21.7 174 52-238 170-356 (417)
244 PF10282 Lactonase: Lactonase, 99.3 1.1E-08 2.5E-13 88.6 26.2 200 22-236 37-275 (345)
245 KOG2315 Predicted translation 99.3 1.4E-09 3.1E-14 93.7 19.7 206 1-237 109-391 (566)
246 PRK00178 tolB translocation pr 99.3 3.2E-09 6.9E-14 95.1 23.0 176 53-239 180-366 (430)
247 PRK04792 tolB translocation pr 99.3 2.6E-09 5.7E-14 95.6 22.1 176 53-239 199-385 (448)
248 KOG1240 Protein kinase contain 99.2 2E-09 4.3E-14 100.7 20.4 210 20-241 1097-1339(1431)
249 TIGR02658 TTQ_MADH_Hv methylam 99.2 3.2E-08 7E-13 84.1 25.9 219 1-243 31-337 (352)
250 PRK01029 tolB translocation pr 99.2 2.1E-09 4.5E-14 95.5 19.6 154 22-185 231-402 (428)
251 PRK04043 tolB translocation pr 99.2 1.9E-08 4.1E-13 88.9 25.0 190 23-237 189-401 (419)
252 KOG1354 Serine/threonine prote 99.2 8.6E-10 1.9E-14 89.6 14.9 206 21-239 25-362 (433)
253 KOG4497 Uncharacterized conser 99.2 1.7E-09 3.7E-14 87.5 15.6 214 2-239 76-394 (447)
254 KOG4547 WD40 repeat-containing 99.2 4E-09 8.7E-14 91.5 18.9 187 43-237 6-221 (541)
255 COG2706 3-carboxymuconate cycl 99.1 3.9E-08 8.5E-13 80.9 22.1 206 19-237 37-275 (346)
256 PF07433 DUF1513: Protein of u 99.1 6.1E-08 1.3E-12 79.7 21.9 178 1-194 32-253 (305)
257 KOG1587 Cytoplasmic dynein int 99.1 2.4E-09 5.1E-14 96.0 14.1 156 20-186 346-516 (555)
258 KOG1409 Uncharacterized conser 99.1 7.3E-09 1.6E-13 84.3 15.4 155 21-186 68-270 (404)
259 KOG0280 Uncharacterized conser 99.1 1.4E-08 3.1E-13 80.9 16.3 150 24-185 124-283 (339)
260 KOG2315 Predicted translation 99.1 1.7E-08 3.7E-13 87.2 17.8 127 52-185 251-389 (566)
261 COG4946 Uncharacterized protei 99.0 5.9E-08 1.3E-12 82.5 18.2 145 19-175 357-508 (668)
262 KOG3914 WD repeat protein WDR4 99.0 1.1E-08 2.4E-13 84.9 13.5 159 75-244 64-231 (390)
263 PF13360 PQQ_2: PQQ-like domai 99.0 4.1E-07 8.9E-12 74.7 22.5 211 2-241 8-235 (238)
264 KOG4190 Uncharacterized conser 99.0 1.1E-09 2.4E-14 94.4 6.8 182 65-251 728-921 (1034)
265 KOG0280 Uncharacterized conser 99.0 1.4E-07 3E-12 75.5 17.9 182 51-238 45-243 (339)
266 PRK04043 tolB translocation pr 99.0 6.1E-07 1.3E-11 79.5 24.0 174 52-239 169-360 (419)
267 KOG3914 WD repeat protein WDR4 99.0 1.2E-08 2.6E-13 84.7 11.9 156 25-194 66-229 (390)
268 PLN02919 haloacid dehalogenase 99.0 6.7E-07 1.5E-11 87.8 25.7 198 24-240 626-892 (1057)
269 KOG1334 WD40 repeat protein [G 98.9 1.3E-08 2.7E-13 86.6 11.4 202 18-237 229-467 (559)
270 PF08450 SGL: SMP-30/Gluconola 98.9 3.5E-06 7.5E-11 69.6 25.6 195 26-242 4-218 (246)
271 TIGR02658 TTQ_MADH_Hv methylam 98.9 1.1E-06 2.4E-11 74.9 22.4 181 1-194 81-336 (352)
272 KOG1064 RAVE (regulator of V-A 98.9 5.6E-09 1.2E-13 101.2 9.4 157 2-186 2235-2398(2439)
273 PF15492 Nbas_N: Neuroblastoma 98.9 1.2E-06 2.6E-11 70.2 19.8 194 23-242 45-265 (282)
274 KOG1409 Uncharacterized conser 98.9 1.1E-07 2.5E-12 77.5 14.0 202 19-238 22-272 (404)
275 PF04762 IKI3: IKI3 family; I 98.9 4.1E-07 9E-12 87.7 20.2 200 19-235 118-378 (928)
276 KOG1275 PAB-dependent poly(A) 98.9 2E-07 4.4E-12 85.3 16.7 182 41-234 146-340 (1118)
277 KOG4190 Uncharacterized conser 98.8 1.1E-08 2.3E-13 88.5 8.2 197 19-237 733-949 (1034)
278 KOG1832 HIV-1 Vpr-binding prot 98.8 4.2E-09 9E-14 95.7 5.9 203 19-255 1099-1313(1516)
279 PF07433 DUF1513: Protein of u 98.8 4.2E-06 9.1E-11 69.1 22.5 203 22-242 5-253 (305)
280 KOG1354 Serine/threonine prote 98.8 1E-07 2.2E-12 77.8 12.9 158 18-186 161-359 (433)
281 KOG2695 WD40 repeat protein [G 98.8 2E-08 4.2E-13 81.9 8.6 144 46-196 228-384 (425)
282 COG4946 Uncharacterized protei 98.8 2.5E-06 5.4E-11 72.9 20.9 168 44-225 334-507 (668)
283 PF00400 WD40: WD domain, G-be 98.8 2.1E-08 4.6E-13 56.7 5.9 38 63-101 2-39 (39)
284 KOG4532 WD40-like repeat conta 98.8 2E-06 4.3E-11 68.2 18.1 198 42-242 84-288 (344)
285 TIGR03300 assembly_YfgL outer 98.8 5.6E-06 1.2E-10 73.0 23.1 181 44-242 147-344 (377)
286 KOG2695 WD40 repeat protein [G 98.8 3.2E-08 6.9E-13 80.8 7.9 123 20-153 251-386 (425)
287 PF04762 IKI3: IKI3 family; I 98.8 1.7E-06 3.7E-11 83.5 20.7 197 21-237 75-334 (928)
288 PF00400 WD40: WD domain, G-be 98.8 3.4E-08 7.4E-13 55.8 5.7 39 7-58 1-39 (39)
289 KOG1912 WD40 repeat protein [G 98.7 1.6E-06 3.6E-11 78.2 17.4 211 19-237 53-305 (1062)
290 PLN02919 haloacid dehalogenase 98.7 5.8E-06 1.3E-10 81.4 22.9 151 24-186 685-888 (1057)
291 KOG4714 Nucleoporin [Nuclear s 98.7 1.7E-07 3.7E-12 73.7 9.6 198 23-237 38-255 (319)
292 KOG2314 Translation initiation 98.7 9.3E-07 2E-11 76.8 14.6 178 25-223 214-410 (698)
293 KOG2314 Translation initiation 98.7 6.2E-06 1.3E-10 71.8 19.4 219 1-237 286-526 (698)
294 COG5170 CDC55 Serine/threonine 98.6 7.6E-07 1.6E-11 72.0 12.4 205 20-238 25-311 (460)
295 COG5354 Uncharacterized protei 98.6 6.4E-06 1.4E-10 70.9 18.5 170 1-186 112-306 (561)
296 TIGR03300 assembly_YfgL outer 98.6 1.5E-05 3.3E-10 70.2 21.8 189 44-242 67-265 (377)
297 PF08450 SGL: SMP-30/Gluconola 98.6 3.6E-05 7.8E-10 63.5 22.3 157 24-197 42-221 (246)
298 KOG1912 WD40 repeat protein [G 98.6 2.9E-06 6.3E-11 76.7 16.0 150 23-185 17-185 (1062)
299 PF13360 PQQ_2: PQQ-like domai 98.6 1.2E-05 2.6E-10 65.9 18.7 181 50-240 1-195 (238)
300 COG5170 CDC55 Serine/threonine 98.6 7.2E-07 1.6E-11 72.1 10.6 203 22-236 86-367 (460)
301 KOG4714 Nucleoporin [Nuclear s 98.6 8.7E-07 1.9E-11 69.8 10.3 140 44-185 103-253 (319)
302 KOG4532 WD40-like repeat conta 98.5 2.4E-05 5.1E-10 62.3 17.9 142 44-186 130-282 (344)
303 KOG0309 Conserved WD40 repeat- 98.5 6.4E-07 1.4E-11 80.3 10.1 158 23-189 69-235 (1081)
304 PF11768 DUF3312: Protein of u 98.5 4.9E-07 1.1E-11 79.4 9.1 77 19-107 257-333 (545)
305 KOG2066 Vacuolar assembly/sort 98.5 3.9E-06 8.5E-11 76.1 14.9 185 22-236 40-233 (846)
306 PRK02888 nitrous-oxide reducta 98.5 7.9E-06 1.7E-10 73.7 16.8 176 49-237 212-405 (635)
307 COG0823 TolB Periplasmic compo 98.5 1.3E-05 2.9E-10 70.7 18.1 152 21-185 192-357 (425)
308 KOG1275 PAB-dependent poly(A) 98.5 2.6E-06 5.7E-11 78.2 13.4 137 44-185 189-341 (1118)
309 KOG1920 IkappaB kinase complex 98.5 3.6E-05 7.8E-10 73.2 20.5 198 21-237 68-323 (1265)
310 KOG0309 Conserved WD40 repeat- 98.5 1.9E-06 4E-11 77.5 11.3 208 19-237 112-340 (1081)
311 COG5354 Uncharacterized protei 98.5 5.8E-06 1.3E-10 71.2 13.4 153 20-186 31-210 (561)
312 COG0823 TolB Periplasmic compo 98.4 2.4E-05 5.1E-10 69.1 16.5 175 53-238 174-360 (425)
313 KOG2041 WD40 repeat protein [G 98.4 4.1E-06 8.8E-11 75.2 11.3 152 21-185 14-185 (1189)
314 KOG2066 Vacuolar assembly/sort 98.4 2.2E-05 4.8E-10 71.4 16.0 135 44-186 85-233 (846)
315 PRK11138 outer membrane biogen 98.4 0.00015 3.2E-09 64.4 21.0 183 44-242 162-359 (394)
316 KOG1645 RING-finger-containing 98.4 1.6E-05 3.5E-10 66.7 13.5 147 19-175 191-350 (463)
317 PRK11138 outer membrane biogen 98.3 0.0001 2.2E-09 65.4 19.1 181 44-242 122-318 (394)
318 KOG2041 WD40 repeat protein [G 98.3 1.5E-05 3.2E-10 71.7 11.9 189 19-227 69-279 (1189)
319 KOG2114 Vacuolar assembly/sort 98.2 0.00015 3.2E-09 66.8 17.5 194 23-238 27-245 (933)
320 COG3391 Uncharacterized conser 98.2 0.0015 3.3E-08 57.5 23.3 198 25-242 77-289 (381)
321 PF06977 SdiA-regulated: SdiA- 98.2 0.0022 4.8E-08 52.3 22.2 157 19-185 19-200 (248)
322 PRK02888 nitrous-oxide reducta 98.2 0.00086 1.9E-08 61.0 21.4 100 82-186 285-404 (635)
323 KOG1920 IkappaB kinase complex 98.1 0.00022 4.7E-09 68.2 17.4 155 19-185 107-321 (1265)
324 KOG3617 WD40 and TPR repeat-co 98.1 1.2E-05 2.5E-10 73.7 8.7 107 25-143 19-131 (1416)
325 KOG3621 WD40 repeat-containing 98.1 3.4E-05 7.4E-10 69.3 11.3 115 21-144 33-155 (726)
326 PF11768 DUF3312: Protein of u 98.1 5.4E-05 1.2E-09 66.9 11.5 89 55-145 239-331 (545)
327 KOG0882 Cyclophilin-related pe 98.1 3.2E-05 6.8E-10 65.9 9.6 210 20-242 8-237 (558)
328 KOG1008 Uncharacterized conser 98.1 1.3E-06 2.9E-11 77.2 1.2 204 22-237 57-276 (783)
329 PF03178 CPSF_A: CPSF A subuni 98.1 0.0034 7.4E-08 54.0 22.1 174 2-186 7-202 (321)
330 KOG0882 Cyclophilin-related pe 98.0 4.2E-05 9.1E-10 65.2 9.7 205 20-240 52-309 (558)
331 PF08553 VID27: VID27 cytoplas 98.0 0.0011 2.4E-08 62.4 19.6 139 44-185 495-646 (794)
332 KOG4649 PQQ (pyrrolo-quinoline 98.0 0.003 6.4E-08 50.6 18.8 92 44-136 65-158 (354)
333 PF06433 Me-amine-dh_H: Methyl 98.0 0.0018 3.8E-08 54.6 18.5 176 52-239 17-216 (342)
334 COG3490 Uncharacterized protei 98.0 0.0014 3E-08 53.1 16.9 212 1-236 95-348 (366)
335 PF08553 VID27: VID27 cytoplas 98.0 0.00045 9.8E-09 65.0 16.3 133 2-142 509-646 (794)
336 KOG4649 PQQ (pyrrolo-quinoline 98.0 0.0053 1.1E-07 49.2 19.6 129 44-175 25-155 (354)
337 PF00930 DPPIV_N: Dipeptidyl p 98.0 0.0015 3.3E-08 57.0 18.6 175 1-190 27-270 (353)
338 KOG1645 RING-finger-containing 98.0 0.00013 2.9E-09 61.3 11.1 149 54-209 175-336 (463)
339 KOG4640 Anaphase-promoting com 97.9 7.5E-05 1.6E-09 66.4 9.5 94 21-125 20-115 (665)
340 KOG3617 WD40 and TPR repeat-co 97.9 0.00034 7.4E-09 64.5 13.1 71 23-103 61-131 (1416)
341 COG3386 Gluconolactonase [Carb 97.8 0.0097 2.1E-07 50.4 20.4 137 44-186 39-193 (307)
342 cd00216 PQQ_DH Dehydrogenases 97.8 0.0037 8E-08 57.1 19.3 190 44-242 63-325 (488)
343 PF02897 Peptidase_S9_N: Proly 97.8 0.0079 1.7E-07 53.8 20.7 193 24-236 126-357 (414)
344 COG3386 Gluconolactonase [Carb 97.8 0.0051 1.1E-07 52.0 17.9 142 22-175 111-275 (307)
345 PRK13616 lipoprotein LpqB; Pro 97.8 0.0063 1.4E-07 56.4 19.7 147 22-186 350-525 (591)
346 COG3204 Uncharacterized protei 97.8 0.012 2.7E-07 48.1 18.7 158 19-185 83-262 (316)
347 PF03178 CPSF_A: CPSF A subuni 97.8 0.0018 3.8E-08 55.8 15.3 177 52-237 2-203 (321)
348 KOG2114 Vacuolar assembly/sort 97.7 0.0074 1.6E-07 56.1 19.3 140 44-185 79-242 (933)
349 KOG3621 WD40 repeat-containing 97.7 0.0049 1.1E-07 56.0 17.9 75 21-104 76-155 (726)
350 cd00216 PQQ_DH Dehydrogenases 97.7 0.019 4.1E-07 52.5 22.1 183 50-242 173-430 (488)
351 KOG1832 HIV-1 Vpr-binding prot 97.7 5.7E-05 1.2E-09 69.8 5.3 162 65-241 1094-1260(1516)
352 smart00320 WD40 WD40 repeats. 97.7 0.00017 3.7E-09 39.4 5.5 38 63-101 3-40 (40)
353 PF15492 Nbas_N: Neuroblastoma 97.7 0.0078 1.7E-07 48.9 16.3 151 21-185 91-258 (282)
354 PF06433 Me-amine-dh_H: Methyl 97.7 0.0079 1.7E-07 50.8 17.0 147 44-194 149-326 (342)
355 KOG1008 Uncharacterized conser 97.7 1.1E-05 2.4E-10 71.5 0.4 158 19-186 100-275 (783)
356 PF00930 DPPIV_N: Dipeptidyl p 97.7 0.0056 1.2E-07 53.4 17.2 79 51-132 22-117 (353)
357 COG3490 Uncharacterized protei 97.7 0.008 1.7E-07 48.9 16.1 143 22-173 68-243 (366)
358 smart00320 WD40 WD40 repeats. 97.6 0.00017 3.7E-09 39.4 5.0 39 7-58 2-40 (40)
359 COG3391 Uncharacterized conser 97.6 0.041 8.8E-07 48.6 25.3 202 23-242 32-245 (381)
360 PF08596 Lgl_C: Lethal giant l 97.6 0.0027 5.9E-08 55.8 14.5 155 20-185 85-289 (395)
361 PF14583 Pectate_lyase22: Olig 97.6 0.0095 2.1E-07 51.3 17.0 222 3-239 16-275 (386)
362 PF04053 Coatomer_WDAD: Coatom 97.6 0.0013 2.8E-08 58.6 12.2 142 20-186 31-173 (443)
363 TIGR03075 PQQ_enz_alc_DH PQQ-d 97.6 0.035 7.7E-07 51.1 21.9 190 44-241 71-338 (527)
364 PF14783 BBS2_Mid: Ciliary BBS 97.5 0.014 3E-07 40.7 14.1 85 24-124 2-89 (111)
365 PF04053 Coatomer_WDAD: Coatom 97.5 0.011 2.4E-07 52.7 16.8 182 23-237 70-263 (443)
366 PF12894 Apc4_WD40: Anaphase-p 97.5 0.00033 7.2E-09 40.6 4.7 37 19-65 9-45 (47)
367 PF04841 Vps16_N: Vps16, N-ter 97.3 0.049 1.1E-06 48.5 19.0 159 6-186 69-246 (410)
368 PHA02713 hypothetical protein; 97.2 0.039 8.5E-07 51.3 17.8 61 44-106 306-378 (557)
369 PF05694 SBP56: 56kDa selenium 97.2 0.12 2.6E-06 45.2 21.0 191 44-238 89-344 (461)
370 KOG2395 Protein involved in va 97.2 0.016 3.4E-07 51.2 13.7 142 42-187 346-501 (644)
371 PF00780 CNH: CNH domain; Int 97.2 0.06 1.3E-06 45.1 17.3 148 83-242 5-171 (275)
372 PF04841 Vps16_N: Vps16, N-ter 97.2 0.15 3.2E-06 45.5 20.3 168 53-237 62-247 (410)
373 KOG4640 Anaphase-promoting com 97.1 0.0036 7.7E-08 56.2 9.2 92 73-165 20-115 (665)
374 PF14783 BBS2_Mid: Ciliary BBS 97.1 0.049 1.1E-06 38.0 13.2 99 76-181 2-109 (111)
375 KOG2079 Vacuolar assembly/sort 97.1 0.0024 5.3E-08 60.7 8.0 98 44-142 101-202 (1206)
376 PF08596 Lgl_C: Lethal giant l 97.0 0.21 4.5E-06 44.1 18.7 200 23-242 3-296 (395)
377 PRK13616 lipoprotein LpqB; Pro 96.9 0.054 1.2E-06 50.4 15.5 102 74-183 350-473 (591)
378 KOG2395 Protein involved in va 96.9 0.019 4.1E-07 50.7 11.6 132 3-142 362-499 (644)
379 PF14870 PSII_BNR: Photosynthe 96.9 0.21 4.6E-06 42.2 17.8 150 20-183 143-301 (302)
380 TIGR03074 PQQ_membr_DH membran 96.9 0.46 9.9E-06 45.8 22.1 69 44-112 196-287 (764)
381 TIGR03075 PQQ_enz_alc_DH PQQ-d 96.8 0.32 7E-06 44.9 19.4 145 44-192 122-337 (527)
382 PF14583 Pectate_lyase22: Olig 96.8 0.31 6.8E-06 42.2 19.7 165 3-185 174-380 (386)
383 PF12234 Rav1p_C: RAVE protein 96.7 0.058 1.3E-06 49.9 13.8 99 44-142 43-155 (631)
384 PF05096 Glu_cyclase_2: Glutam 96.7 0.27 5.9E-06 40.3 19.2 127 44-175 102-250 (264)
385 KOG2444 WD40 repeat protein [G 96.6 0.01 2.2E-07 46.7 7.1 100 44-144 72-178 (238)
386 PHA03098 kelch-like protein; P 96.6 0.27 5.9E-06 45.7 17.6 99 44-146 297-417 (534)
387 PF00780 CNH: CNH domain; Int 96.5 0.41 8.9E-06 40.1 22.3 195 23-245 37-264 (275)
388 KOG1897 Damage-specific DNA bi 96.5 0.3 6.5E-06 46.8 16.6 177 53-237 751-943 (1096)
389 TIGR02604 Piru_Ver_Nterm putat 96.4 0.35 7.5E-06 42.5 16.3 138 22-173 14-201 (367)
390 KOG2079 Vacuolar assembly/sort 96.4 0.014 3E-07 55.8 7.7 69 19-97 128-199 (1206)
391 KOG4499 Ca2+-binding protein R 96.4 0.38 8.3E-06 38.4 14.6 91 75-165 159-263 (310)
392 PF12894 Apc4_WD40: Anaphase-p 96.4 0.014 3E-07 33.9 5.0 34 72-106 10-43 (47)
393 PRK10115 protease 2; Provision 96.3 1.1 2.3E-05 43.1 23.4 109 22-142 127-254 (686)
394 PRK13684 Ycf48-like protein; P 96.3 0.67 1.4E-05 40.1 17.5 151 21-184 172-329 (334)
395 PF05694 SBP56: 56kDa selenium 96.0 1.1 2.3E-05 39.6 21.1 135 52-186 157-342 (461)
396 KOG4499 Ca2+-binding protein R 95.9 0.67 1.5E-05 37.0 15.3 189 44-242 29-247 (310)
397 PF15390 DUF4613: Domain of un 95.9 0.46 9.9E-06 43.1 14.2 146 22-185 20-185 (671)
398 KOG1897 Damage-specific DNA bi 95.9 1.8 3.9E-05 41.9 20.2 196 23-233 776-1001(1096)
399 PF06977 SdiA-regulated: SdiA- 95.9 0.81 1.7E-05 37.6 21.2 163 6-183 52-247 (248)
400 TIGR03074 PQQ_membr_DH membran 95.8 2.1 4.5E-05 41.5 21.1 144 44-192 262-481 (764)
401 PF15390 DUF4613: Domain of un 95.7 0.98 2.1E-05 41.2 15.6 117 22-144 57-187 (671)
402 PF02897 Peptidase_S9_N: Proly 95.7 1.5 3.2E-05 39.3 23.4 171 1-185 154-356 (414)
403 KOG4441 Proteins containing BT 95.7 0.95 2.1E-05 42.3 16.3 101 44-147 335-456 (571)
404 KOG2444 WD40 repeat protein [G 95.6 0.028 6.1E-07 44.3 5.2 138 44-185 32-176 (238)
405 PHA02713 hypothetical protein; 95.5 0.82 1.8E-05 42.7 15.4 134 44-185 354-532 (557)
406 PF10647 Gmad1: Lipoprotein Lp 95.4 1.3 2.9E-05 36.6 20.7 147 22-182 24-192 (253)
407 PLN00033 photosystem II stabil 95.3 1.9 4.1E-05 38.3 17.8 143 25-183 242-396 (398)
408 COG3204 Uncharacterized protei 95.3 1.4 3.1E-05 36.6 17.1 165 72-237 84-264 (316)
409 PF07250 Glyoxal_oxid_N: Glyox 95.1 0.3 6.4E-06 39.8 9.8 143 1-156 50-210 (243)
410 PHA02790 Kelch-like protein; P 95.1 2.6 5.6E-05 38.6 17.9 100 44-146 274-387 (480)
411 PF10313 DUF2415: Uncharacteri 94.9 0.12 2.6E-06 29.1 4.9 31 74-104 1-34 (43)
412 PF14870 PSII_BNR: Photosynthe 94.8 2.1 4.6E-05 36.3 19.7 108 72-181 143-256 (302)
413 KOG2377 Uncharacterized conser 94.8 2.8 6E-05 37.2 17.6 114 72-185 65-184 (657)
414 PHA03098 kelch-like protein; P 94.6 1.8 3.9E-05 40.3 15.0 137 44-185 345-510 (534)
415 PF12234 Rav1p_C: RAVE protein 94.6 2.9 6.3E-05 39.2 15.7 106 77-185 33-155 (631)
416 PF14655 RAB3GAP2_N: Rab3 GTPa 94.5 0.77 1.7E-05 40.7 11.5 85 19-113 305-408 (415)
417 KOG4441 Proteins containing BT 94.4 3.8 8.1E-05 38.4 16.4 140 44-186 287-452 (571)
418 KOG2280 Vacuolar assembly/sort 94.4 1.6 3.4E-05 41.0 13.3 150 23-186 85-246 (829)
419 PF10313 DUF2415: Uncharacteri 94.4 0.17 3.6E-06 28.5 4.6 34 22-61 1-34 (43)
420 COG5167 VID27 Protein involved 94.2 2.1 4.5E-05 38.4 13.1 140 44-189 482-635 (776)
421 COG1520 FOG: WD40-like repeat 94.1 3.9 8.5E-05 36.0 18.1 106 44-150 70-178 (370)
422 PF07569 Hira: TUP1-like enhan 94.0 0.55 1.2E-05 37.9 8.9 29 81-109 18-46 (219)
423 PRK13684 Ycf48-like protein; P 93.9 3.9 8.5E-05 35.4 19.1 152 73-235 172-330 (334)
424 COG4257 Vgb Streptogramin lyas 93.8 3.3 7.2E-05 34.2 14.8 110 75-185 63-185 (353)
425 PF07995 GSDH: Glucose / Sorbo 93.8 3 6.5E-05 36.1 13.6 99 23-132 3-130 (331)
426 KOG1900 Nuclear pore complex, 93.7 4 8.7E-05 41.0 15.3 137 47-186 94-272 (1311)
427 PF10168 Nup88: Nuclear pore c 93.7 6.6 0.00014 37.8 16.6 79 19-106 82-182 (717)
428 KOG1916 Nuclear protein, conta 93.7 0.082 1.8E-06 50.0 4.0 83 22-115 181-282 (1283)
429 PF14655 RAB3GAP2_N: Rab3 GTPa 93.6 1.3 2.9E-05 39.3 11.2 81 72-152 306-407 (415)
430 PF10168 Nup88: Nuclear pore c 93.5 3.1 6.8E-05 39.9 14.3 25 75-99 86-110 (717)
431 PF07676 PD40: WD40-like Beta 93.5 0.46 9.9E-06 26.1 5.5 33 151-183 4-38 (39)
432 PF07569 Hira: TUP1-like enhan 93.4 0.89 1.9E-05 36.6 9.2 59 44-103 24-95 (219)
433 COG4257 Vgb Streptogramin lyas 93.0 4.5 9.7E-05 33.4 17.6 187 23-237 63-263 (353)
434 COG5167 VID27 Protein involved 92.9 1.4 3.1E-05 39.4 10.1 131 3-143 496-632 (776)
435 PF05935 Arylsulfotrans: Aryls 92.8 7.7 0.00017 35.5 18.0 182 50-239 126-370 (477)
436 PF14761 HPS3_N: Hermansky-Pud 92.5 4.5 9.7E-05 32.1 11.5 45 130-175 33-79 (215)
437 PF05096 Glu_cyclase_2: Glutam 92.4 5.5 0.00012 32.9 21.3 151 19-185 41-202 (264)
438 PF10647 Gmad1: Lipoprotein Lp 92.3 5.6 0.00012 32.9 18.9 108 75-185 25-143 (253)
439 PF12657 TFIIIC_delta: Transcr 92.2 1.1 2.3E-05 34.7 7.9 30 75-104 87-122 (173)
440 PF12768 Rax2: Cortical protei 91.7 3.7 8.1E-05 34.4 10.9 89 2-104 21-124 (281)
441 PF03088 Str_synth: Strictosid 91.7 1.7 3.6E-05 29.3 7.2 42 91-133 33-74 (89)
442 KOG1916 Nuclear protein, conta 91.7 0.34 7.4E-06 46.1 5.1 106 51-187 152-266 (1283)
443 TIGR02276 beta_rpt_yvtn 40-res 91.6 1.4 3E-05 24.4 6.3 40 83-123 1-41 (42)
444 PHA02790 Kelch-like protein; P 91.6 11 0.00024 34.6 16.2 97 44-146 321-426 (480)
445 PF10214 Rrn6: RNA polymerase 91.4 15 0.00032 36.0 16.2 110 74-186 146-276 (765)
446 KOG3630 Nuclear pore complex, 91.4 0.37 8E-06 47.0 5.2 99 23-132 157-260 (1405)
447 KOG2280 Vacuolar assembly/sort 91.3 14 0.0003 35.2 15.7 86 52-141 64-153 (829)
448 KOG3630 Nuclear pore complex, 90.9 3.8 8.1E-05 40.6 11.2 109 75-185 102-227 (1405)
449 PF11715 Nup160: Nucleoporin N 90.9 5.1 0.00011 37.5 12.3 71 44-114 160-259 (547)
450 KOG2247 WD40 repeat-containing 90.7 0.018 3.8E-07 50.5 -3.6 142 24-180 37-182 (615)
451 KOG1898 Splicing factor 3b, su 90.4 16 0.00035 36.2 14.7 175 53-237 854-1049(1205)
452 smart00564 PQQ beta-propeller 90.4 0.8 1.7E-05 23.9 4.0 25 44-68 8-32 (33)
453 PF14761 HPS3_N: Hermansky-Pud 90.3 7.9 0.00017 30.8 15.0 100 44-145 30-165 (215)
454 PLN00033 photosystem II stabil 90.3 13 0.00028 33.1 17.8 105 76-184 241-354 (398)
455 PF01011 PQQ: PQQ enzyme repea 90.2 0.84 1.8E-05 25.0 4.0 27 44-70 2-28 (38)
456 PF14781 BBS2_N: Ciliary BBSom 90.1 5.8 0.00013 28.9 12.6 101 44-148 12-130 (136)
457 KOG4460 Nuclear pore complex, 89.4 16 0.00036 33.2 13.7 27 75-101 105-131 (741)
458 TIGR02604 Piru_Ver_Nterm putat 89.3 15 0.00031 32.4 15.7 100 74-174 14-142 (367)
459 PF12768 Rax2: Cortical protei 89.2 12 0.00026 31.4 11.9 93 51-145 15-125 (281)
460 KOG2377 Uncharacterized conser 89.2 3.7 7.9E-05 36.4 8.9 105 20-135 65-173 (657)
461 TIGR03032 conserved hypothetic 89.1 7.9 0.00017 32.8 10.5 44 44-91 215-258 (335)
462 PF10214 Rrn6: RNA polymerase 89.0 25 0.00053 34.6 18.4 113 22-144 146-277 (765)
463 TIGR03606 non_repeat_PQQ dehyd 88.1 20 0.00043 32.5 13.7 102 22-132 30-162 (454)
464 TIGR03548 mutarot_permut cycli 87.9 17 0.00036 31.3 18.0 99 84-185 72-193 (323)
465 PF07995 GSDH: Glucose / Sorbo 87.8 17 0.00037 31.5 12.4 99 75-175 3-133 (331)
466 TIGR03032 conserved hypothetic 87.8 16 0.00035 31.0 12.1 70 56-133 189-258 (335)
467 KOG3616 Selective LIM binding 87.7 9.3 0.0002 36.3 10.9 150 21-186 14-193 (1636)
468 PF07250 Glyoxal_oxid_N: Glyox 87.6 10 0.00022 31.0 10.2 88 97-184 48-146 (243)
469 PF13449 Phytase-like: Esteras 87.6 18 0.00038 31.3 16.1 103 72-175 18-166 (326)
470 PF12657 TFIIIC_delta: Transcr 87.4 8.4 0.00018 29.7 9.4 25 117-141 6-30 (173)
471 COG5276 Uncharacterized conser 86.5 18 0.0004 30.3 18.8 105 74-185 87-198 (370)
472 smart00564 PQQ beta-propeller 86.4 2 4.4E-05 22.3 3.9 26 86-111 7-32 (33)
473 PF10395 Utp8: Utp8 family; I 86.1 32 0.00069 32.7 19.2 159 72-242 128-311 (670)
474 PF07676 PD40: WD40-like Beta 86.0 3.9 8.5E-05 22.2 5.3 29 72-100 7-38 (39)
475 TIGR03118 PEPCTERM_chp_1 conse 85.4 21 0.00046 30.2 19.2 207 23-242 24-285 (336)
476 TIGR02276 beta_rpt_yvtn 40-res 85.0 4.7 0.0001 22.2 5.8 29 125-153 1-32 (42)
477 PF01011 PQQ: PQQ enzyme repea 84.8 3.2 6.9E-05 22.6 4.3 27 87-113 2-28 (38)
478 COG4590 ABC-type uncharacteriz 84.5 9.1 0.0002 34.1 8.8 155 19-186 218-386 (733)
479 PF14781 BBS2_N: Ciliary BBSom 84.4 14 0.0003 27.0 11.7 103 79-185 4-124 (136)
480 TIGR03606 non_repeat_PQQ dehyd 84.4 32 0.00069 31.2 13.6 103 73-175 29-165 (454)
481 PF13570 PQQ_3: PQQ-like domai 84.1 3.9 8.4E-05 22.5 4.5 21 84-104 20-40 (40)
482 PF03022 MRJP: Major royal jel 83.7 26 0.00056 29.7 18.1 169 1-172 38-252 (287)
483 PF08728 CRT10: CRT10; InterP 83.5 27 0.00058 33.5 12.0 139 44-185 51-245 (717)
484 KOG1896 mRNA cleavage and poly 83.2 57 0.0012 33.2 17.8 140 44-187 1048-1214(1366)
485 KOG0918 Selenium-binding prote 82.8 32 0.0007 30.2 11.1 98 1-106 233-345 (476)
486 COG3823 Glutamine cyclotransfe 82.7 22 0.00048 28.2 10.4 119 126-260 55-177 (262)
487 COG3292 Predicted periplasmic 82.5 32 0.00068 31.8 11.4 100 45-146 389-494 (671)
488 PF13449 Phytase-like: Esteras 82.4 32 0.00069 29.7 16.7 155 21-186 19-249 (326)
489 PF05935 Arylsulfotrans: Aryls 81.5 44 0.00094 30.7 15.3 114 27-154 153-312 (477)
490 PRK10115 protease 2; Provision 81.3 55 0.0012 31.8 25.9 149 25-186 175-344 (686)
491 KOG1983 Tomosyn and related SN 81.0 67 0.0015 32.6 14.5 32 215-246 243-274 (993)
492 PF14269 Arylsulfotran_2: Aryl 80.7 35 0.00076 29.1 15.1 134 48-184 21-218 (299)
493 TIGR02171 Fb_sc_TIGR02171 Fibr 80.2 18 0.00038 35.5 9.7 87 44-132 321-415 (912)
494 PF14779 BBS1: Ciliary BBSome 79.1 26 0.00057 28.9 9.2 77 20-100 175-255 (257)
495 KOG2247 WD40 repeat-containing 79.0 0.39 8.5E-06 42.5 -1.2 99 22-131 75-175 (615)
496 KOG4460 Nuclear pore complex, 78.8 53 0.0012 30.1 13.6 25 118-142 106-131 (741)
497 TIGR03054 photo_alph_chp1 puta 78.4 17 0.00037 26.6 7.1 66 44-109 43-119 (135)
498 PF03022 MRJP: Major royal jel 77.9 42 0.00091 28.4 17.7 132 53-185 35-214 (287)
499 PF03088 Str_synth: Strictosid 77.8 19 0.0004 24.3 7.8 40 135-175 37-76 (89)
500 COG5276 Uncharacterized conser 76.4 46 0.00099 28.1 22.3 136 44-185 98-240 (370)
No 1
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=100.00 E-value=2.6e-37 Score=251.74 Aligned_cols=225 Identities=15% Similarity=0.174 Sum_probs=201.4
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeecc--ccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFV--GKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAG 78 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~--~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~ 78 (340)
||+..++..+..|. +|...|.++.|+|. +. -+|+|+.||++++|++.+...+..+.+ |...|..
T Consensus 201 vW~~~~~~~~~~l~----gH~~~v~~~~fhP~~~~~---------~lat~s~Dgtvklw~~~~e~~l~~l~g-H~~RVs~ 266 (459)
T KOG0272|consen 201 VWSVPQCNLLQTLR----GHTSRVGAAVFHPVDSDL---------NLATASADGTVKLWKLSQETPLQDLEG-HLARVSR 266 (459)
T ss_pred EeecCCcceeEEEe----ccccceeeEEEccCCCcc---------ceeeeccCCceeeeccCCCcchhhhhc-chhhhee
Confidence 68999999999998 99999999999998 34 699999999999999999888999999 9999999
Q ss_pred EEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCC
Q 036605 79 LAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVG 156 (340)
Q Consensus 79 v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~ 156 (340)
++|+|+|++|.|++.|.+-++||+.++..+....+|..+|.+++|.|||..+++++-+ -+|||+++|+.+..+.+|..
T Consensus 267 VafHPsG~~L~TasfD~tWRlWD~~tk~ElL~QEGHs~~v~~iaf~~DGSL~~tGGlD~~~RvWDlRtgr~im~L~gH~k 346 (459)
T KOG0272|consen 267 VAFHPSGKFLGTASFDSTWRLWDLETKSELLLQEGHSKGVFSIAFQPDGSLAATGGLDSLGRVWDLRTGRCIMFLAGHIK 346 (459)
T ss_pred eeecCCCceeeecccccchhhcccccchhhHhhcccccccceeEecCCCceeeccCccchhheeecccCcEEEEeccccc
Confidence 9999999999999999999999999999988899999999999999999999998887 89999999999999999999
Q ss_pred CeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECC
Q 036605 157 PLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 157 ~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
.|.++.|+|+|..+++++. |++++|||++. ......+. .|...+..+ .+....|.+|++++.|++++||...
T Consensus 347 ~I~~V~fsPNGy~lATgs~-Dnt~kVWDLR~--r~~ly~ip---AH~nlVS~V--k~~p~~g~fL~TasyD~t~kiWs~~ 418 (459)
T KOG0272|consen 347 EILSVAFSPNGYHLATGSS-DNTCKVWDLRM--RSELYTIP---AHSNLVSQV--KYSPQEGYFLVTASYDNTVKIWSTR 418 (459)
T ss_pred ceeeEeECCCceEEeecCC-CCcEEEeeecc--cccceecc---cccchhhhe--EecccCCeEEEEcccCcceeeecCC
Confidence 9999999999998999777 99999999963 22233333 677777777 6623489999999999999999999
Q ss_pred CCCccCCCCCc
Q 036605 237 TVSQDEKTNPA 247 (340)
Q Consensus 237 ~~~~~~~~~p~ 247 (340)
+...+..+..+
T Consensus 419 ~~~~~ksLaGH 429 (459)
T KOG0272|consen 419 TWSPLKSLAGH 429 (459)
T ss_pred CcccchhhcCC
Confidence 98887766653
No 2
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=100.00 E-value=5.2e-36 Score=244.16 Aligned_cols=211 Identities=19% Similarity=0.242 Sum_probs=194.8
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
+|++++...+..+. +|...|..++|+|+|+ +|++++.|.+-++||+.++..+....+ |...|.+++
T Consensus 245 lw~~~~e~~l~~l~----gH~~RVs~VafHPsG~---------~L~TasfD~tWRlWD~~tk~ElL~QEG-Hs~~v~~ia 310 (459)
T KOG0272|consen 245 LWKLSQETPLQDLE----GHLARVSRVAFHPSGK---------FLGTASFDSTWRLWDLETKSELLLQEG-HSKGVFSIA 310 (459)
T ss_pred eeccCCCcchhhhh----cchhhheeeeecCCCc---------eeeecccccchhhcccccchhhHhhcc-cccccceeE
Confidence 68888888888888 8999999999999999 999999999999999999987776677 999999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCe
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPL 158 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v 158 (340)
|++||.++++||.|..-+|||+++|+.+..+.+|..+|.+++|+|+|..+++++++ ++|||++....+..+.+|..-|
T Consensus 311 f~~DGSL~~tGGlD~~~RvWDlRtgr~im~L~gH~k~I~~V~fsPNGy~lATgs~Dnt~kVWDLR~r~~ly~ipAH~nlV 390 (459)
T KOG0272|consen 311 FQPDGSLAATGGLDSLGRVWDLRTGRCIMFLAGHIKEILSVAFSPNGYHLATGSSDNTCKVWDLRMRSELYTIPAHSNLV 390 (459)
T ss_pred ecCCCceeeccCccchhheeecccCcEEEEecccccceeeEeECCCceEEeecCCCCcEEEeeecccccceecccccchh
Confidence 99999999999999999999999999999999999999999999999999997666 9999999999999999999999
Q ss_pred EEEEECC-CCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEE
Q 036605 159 QYVSASD-GAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWD 234 (340)
Q Consensus 159 ~~~~~s~-~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd 234 (340)
+.+.|+| .|.+|++++. |++++||.- .+......+. +|...++.+ .. ++++.++++++.|.++++|.
T Consensus 391 S~Vk~~p~~g~fL~Tasy-D~t~kiWs~--~~~~~~ksLa---GHe~kV~s~--Di-s~d~~~i~t~s~DRT~KLW~ 458 (459)
T KOG0272|consen 391 SQVKYSPQEGYFLVTASY-DNTVKIWST--RTWSPLKSLA---GHEGKVISL--DI-SPDSQAIATSSFDRTIKLWR 458 (459)
T ss_pred hheEecccCCeEEEEccc-CcceeeecC--CCcccchhhc---CCccceEEE--Ee-ccCCceEEEeccCceeeecc
Confidence 9999998 6788888887 999999997 5666677777 899888877 55 89999999999999999995
No 3
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=100.00 E-value=5.1e-34 Score=230.03 Aligned_cols=223 Identities=17% Similarity=0.215 Sum_probs=194.0
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEE-EecCCCCCCeEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKW-KSTGRHPGGLAGL 79 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~-~~~~~h~~~v~~v 79 (340)
+||+.+.....+.+ +|..-|.|++|+|||+ .||+|+.||+|++||.++|+.+. .+.+ |...|+++
T Consensus 141 ~WD~~TeTp~~t~K----gH~~WVlcvawsPDgk---------~iASG~~dg~I~lwdpktg~~~g~~l~g-H~K~It~L 206 (480)
T KOG0271|consen 141 LWDLDTETPLFTCK----GHKNWVLCVAWSPDGK---------KIASGSKDGSIRLWDPKTGQQIGRALRG-HKKWITAL 206 (480)
T ss_pred eeccCCCCcceeec----CCccEEEEEEECCCcc---------hhhccccCCeEEEecCCCCCcccccccC-cccceeEE
Confidence 69999999998888 9999999999999999 89999999999999999998654 5566 99999999
Q ss_pred EEec-----CCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEee
Q 036605 80 AFAK-----KGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFS 152 (340)
Q Consensus 80 ~~~~-----~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~ 152 (340)
+|.| ..++|++++.||.|++||+..+..+..+.+|..+|+|+.|-.+| ++++++.+ |++|+...|...+.+.
T Consensus 207 awep~hl~p~~r~las~skDg~vrIWd~~~~~~~~~lsgHT~~VTCvrwGG~g-liySgS~DrtIkvw~a~dG~~~r~lk 285 (480)
T KOG0271|consen 207 AWEPLHLVPPCRRLASSSKDGSVRIWDTKLGTCVRTLSGHTASVTCVRWGGEG-LIYSGSQDRTIKVWRALDGKLCRELK 285 (480)
T ss_pred eecccccCCCccceecccCCCCEEEEEccCceEEEEeccCccceEEEEEcCCc-eEEecCCCceEEEEEccchhHHHhhc
Confidence 9976 56789999999999999999999999999999999999998766 55665544 9999999999999999
Q ss_pred cCCCCeEEEEECCC-----------CC-------------------------EEEEEEcCCCeEEEEEccCCCCCccCCc
Q 036605 153 DDVGPLQYVSASDG-----------AK-------------------------IIITAGYGEKHLQVWRCDISSKTVNKGP 196 (340)
Q Consensus 153 ~~~~~v~~~~~s~~-----------~~-------------------------~l~s~~~~d~~i~iwd~~~~~~~~~~~~ 196 (340)
+|...|+.++++.+ ++ .+++++. |.++.+|+-. ..++.+...
T Consensus 286 GHahwvN~lalsTdy~LRtgaf~~t~~~~~~~se~~~~Al~rY~~~~~~~~erlVSgsD-d~tlflW~p~-~~kkpi~rm 363 (480)
T KOG0271|consen 286 GHAHWVNHLALSTDYVLRTGAFDHTGRKPKSFSEEQKKALERYEAVLKDSGERLVSGSD-DFTLFLWNPF-KSKKPITRM 363 (480)
T ss_pred ccchheeeeeccchhhhhccccccccccCCChHHHHHHHHHHHHHhhccCcceeEEecC-CceEEEeccc-ccccchhhh
Confidence 99999999988622 33 4888777 9999999963 233344455
Q ss_pred eeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCC
Q 036605 197 ALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 197 ~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p 246 (340)
. +|...+..+ .| +||+.++++++-|..|++|+..+++.+..++.
T Consensus 364 t---gHq~lVn~V--~f-SPd~r~IASaSFDkSVkLW~g~tGk~lasfRG 407 (480)
T KOG0271|consen 364 T---GHQALVNHV--SF-SPDGRYIASASFDKSVKLWDGRTGKFLASFRG 407 (480)
T ss_pred h---chhhheeeE--EE-CCCccEEEEeecccceeeeeCCCcchhhhhhh
Confidence 5 888888888 88 99999999999999999999999999987775
No 4
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=100.00 E-value=5.6e-34 Score=249.05 Aligned_cols=214 Identities=15% Similarity=0.192 Sum_probs=194.5
Q ss_pred CCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecC
Q 036605 5 NDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKK 84 (340)
Q Consensus 5 ~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~ 84 (340)
.++....++. +|+++|....|+|+.+ +|++++.|++|++|.+.+...+..+.+ |..+|.++.|+|.
T Consensus 439 ~~~~~~~~L~----GH~GPVyg~sFsPd~r---------fLlScSED~svRLWsl~t~s~~V~y~G-H~~PVwdV~F~P~ 504 (707)
T KOG0263|consen 439 DSSGTSRTLY----GHSGPVYGCSFSPDRR---------FLLSCSEDSSVRLWSLDTWSCLVIYKG-HLAPVWDVQFAPR 504 (707)
T ss_pred cCCceeEEee----cCCCceeeeeeccccc---------ceeeccCCcceeeeecccceeEEEecC-CCcceeeEEecCC
Confidence 3444445565 8999999999999999 999999999999999999998888997 9999999999999
Q ss_pred CCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEE
Q 036605 85 GRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVS 162 (340)
Q Consensus 85 ~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~ 162 (340)
|-+++|++.|++-++|......+++.+.+|-..|.|+.|+|+..++++++.+ +++||..+|..++.|.+|.++|.+++
T Consensus 505 GyYFatas~D~tArLWs~d~~~PlRifaghlsDV~cv~FHPNs~Y~aTGSsD~tVRlWDv~~G~~VRiF~GH~~~V~al~ 584 (707)
T KOG0263|consen 505 GYYFATASHDQTARLWSTDHNKPLRIFAGHLSDVDCVSFHPNSNYVATGSSDRTVRLWDVSTGNSVRIFTGHKGPVTALA 584 (707)
T ss_pred ceEEEecCCCceeeeeecccCCchhhhcccccccceEEECCcccccccCCCCceEEEEEcCCCcEEEEecCCCCceEEEE
Confidence 9999999999999999999999999999999999999999999999997655 99999999999999999999999999
Q ss_pred ECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCcc
Q 036605 163 ASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQD 241 (340)
Q Consensus 163 ~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~ 241 (340)
|+|+|++|++++. |+.|.+||+ ..+.....+. +|...+..+ .| +.+|..|++|+.|..|++||+......
T Consensus 585 ~Sp~Gr~LaSg~e-d~~I~iWDl--~~~~~v~~l~---~Ht~ti~Sl--sF-S~dg~vLasgg~DnsV~lWD~~~~~~~ 654 (707)
T KOG0263|consen 585 FSPCGRYLASGDE-DGLIKIWDL--ANGSLVKQLK---GHTGTIYSL--SF-SRDGNVLASGGADNSVRLWDLTKVIEL 654 (707)
T ss_pred EcCCCceEeeccc-CCcEEEEEc--CCCcchhhhh---cccCceeEE--EE-ecCCCEEEecCCCCeEEEEEchhhccc
Confidence 9999999999888 999999999 6667666666 787777777 77 899999999999999999999764433
No 5
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=100.00 E-value=3e-32 Score=208.10 Aligned_cols=222 Identities=16% Similarity=0.242 Sum_probs=186.1
Q ss_pred CccCCCCce--eeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEE
Q 036605 1 IWSTNDGSL--LAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAG 78 (340)
Q Consensus 1 vwd~~~g~~--~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~ 78 (340)
|||+.++.. +..|. +|...|+++.|..+|+ .+++|+.||+++|||++.....+.+. |..+|++
T Consensus 65 lyD~~S~np~Pv~t~e----~h~kNVtaVgF~~dgr---------WMyTgseDgt~kIWdlR~~~~qR~~~--~~spVn~ 129 (311)
T KOG0315|consen 65 LYDLNSNNPNPVATFE----GHTKNVTAVGFQCDGR---------WMYTGSEDGTVKIWDLRSLSCQRNYQ--HNSPVNT 129 (311)
T ss_pred EEEccCCCCCceeEEe----ccCCceEEEEEeecCe---------EEEecCCCceEEEEeccCcccchhcc--CCCCcce
Confidence 578877654 56776 8999999999999999 99999999999999999976666665 8899999
Q ss_pred EEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEe-ecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCC------ceeE
Q 036605 79 LAFAKKGRSLHVVGTNGMASEMKSEMGEVIREF-KASEKPISSSAFLCEEKIFALASSE--VRILSLENG------EEVL 149 (340)
Q Consensus 79 v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~-~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~------~~~~ 149 (340)
+..+|+...|++|..+|.|++||+......+.+ .....+|.++.+.|||.+++.+... .++|++-+. +++.
T Consensus 130 vvlhpnQteLis~dqsg~irvWDl~~~~c~~~liPe~~~~i~sl~v~~dgsml~a~nnkG~cyvW~l~~~~~~s~l~P~~ 209 (311)
T KOG0315|consen 130 VVLHPNQTELISGDQSGNIRVWDLGENSCTHELIPEDDTSIQSLTVMPDGSMLAAANNKGNCYVWRLLNHQTASELEPVH 209 (311)
T ss_pred EEecCCcceEEeecCCCcEEEEEccCCccccccCCCCCcceeeEEEcCCCcEEEEecCCccEEEEEccCCCccccceEhh
Confidence 999999999999999999999999887555543 3345689999999999999886554 999998654 3457
Q ss_pred EeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCC-CccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCC
Q 036605 150 KFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSK-TVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESG 228 (340)
Q Consensus 150 ~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg 228 (340)
+|+.|.+.+..+.+|||++||++++. |.+++||+.+ .- .....+. +|..++.++ .| +.|+.||++|+.|+
T Consensus 210 k~~ah~~~il~C~lSPd~k~lat~ss-dktv~iwn~~--~~~kle~~l~---gh~rWvWdc--~F-S~dg~YlvTassd~ 280 (311)
T KOG0315|consen 210 KFQAHNGHILRCLLSPDVKYLATCSS-DKTVKIWNTD--DFFKLELVLT---GHQRWVWDC--AF-SADGEYLVTASSDH 280 (311)
T ss_pred heecccceEEEEEECCCCcEEEeecC-CceEEEEecC--CceeeEEEee---cCCceEEee--ee-ccCccEEEecCCCC
Confidence 78999999999999999999999888 9999999983 22 1112222 677888888 88 89999999999999
Q ss_pred cEEEEECCCCCccCCCCC
Q 036605 229 VAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 229 ~i~vwd~~~~~~~~~~~p 246 (340)
.+++|++..++++....+
T Consensus 281 ~~rlW~~~~~k~v~qy~g 298 (311)
T KOG0315|consen 281 TARLWDLSAGKEVRQYQG 298 (311)
T ss_pred ceeecccccCceeeecCC
Confidence 999999999887764444
No 6
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=100.00 E-value=4.7e-32 Score=210.22 Aligned_cols=219 Identities=16% Similarity=0.149 Sum_probs=185.4
Q ss_pred CCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEec
Q 036605 4 TNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAK 83 (340)
Q Consensus 4 ~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~ 83 (340)
...|..+..|+ +|+-.|+.++.++++. +.++++.|+++++||+.+++..+.|.+ |...|.+++|++
T Consensus 50 ~~~G~~~r~~~----GHsH~v~dv~~s~dg~---------~alS~swD~~lrlWDl~~g~~t~~f~G-H~~dVlsva~s~ 115 (315)
T KOG0279|consen 50 IKYGVPVRRLT----GHSHFVSDVVLSSDGN---------FALSASWDGTLRLWDLATGESTRRFVG-HTKDVLSVAFST 115 (315)
T ss_pred cccCceeeeee----ccceEecceEEccCCc---------eEEeccccceEEEEEecCCcEEEEEEe-cCCceEEEEecC
Confidence 35677788888 8999999999999999 999999999999999999999999999 999999999999
Q ss_pred CCCEEEEEeCCCcEEEEeCCCCeEEEEeecC-CCCeeEEEEccC--CCEEEEecCc--EEEEECCCCceeEEeecCCCCe
Q 036605 84 KGRSLHVVGTNGMASEMKSEMGEVIREFKAS-EKPISSSAFLCE--EKIFALASSE--VRILSLENGEEVLKFSDDVGPL 158 (340)
Q Consensus 84 ~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~-~~~i~~l~~~~~--~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v 158 (340)
|.+.+++|+.|.+|.+|+............. ..-|+|+.|+|+ ..++++++.+ |++||+++-+....+.+|.+.+
T Consensus 116 dn~qivSGSrDkTiklwnt~g~ck~t~~~~~~~~WVscvrfsP~~~~p~Ivs~s~DktvKvWnl~~~~l~~~~~gh~~~v 195 (315)
T KOG0279|consen 116 DNRQIVSGSRDKTIKLWNTLGVCKYTIHEDSHREWVSCVRFSPNESNPIIVSASWDKTVKVWNLRNCQLRTTFIGHSGYV 195 (315)
T ss_pred CCceeecCCCcceeeeeeecccEEEEEecCCCcCcEEEEEEcCCCCCcEEEEccCCceEEEEccCCcchhhccccccccE
Confidence 9999999999999999998765443333332 678999999998 6777775544 9999999999889999999999
Q ss_pred EEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 159 QYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 159 ~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
+.+.+||||..+++++. ||.+.+||++ .++. ...+++...+..+ +| +|+...|+.+...+ |+|||+.+.
T Consensus 196 ~t~~vSpDGslcasGgk-dg~~~LwdL~--~~k~----lysl~a~~~v~sl--~f-spnrywL~~at~~s-IkIwdl~~~ 264 (315)
T KOG0279|consen 196 NTVTVSPDGSLCASGGK-DGEAMLWDLN--EGKN----LYSLEAFDIVNSL--CF-SPNRYWLCAATATS-IKIWDLESK 264 (315)
T ss_pred EEEEECCCCCEEecCCC-CceEEEEEcc--CCce----eEeccCCCeEeeE--Ee-cCCceeEeeccCCc-eEEEeccch
Confidence 99999999999999777 9999999994 3333 3444666677776 77 78877666666555 999999998
Q ss_pred CccCCCCCc
Q 036605 239 SQDEKTNPA 247 (340)
Q Consensus 239 ~~~~~~~p~ 247 (340)
..+..+++.
T Consensus 265 ~~v~~l~~d 273 (315)
T KOG0279|consen 265 AVVEELKLD 273 (315)
T ss_pred hhhhhcccc
Confidence 888877763
No 7
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=100.00 E-value=6.1e-32 Score=209.60 Aligned_cols=216 Identities=12% Similarity=0.145 Sum_probs=180.2
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecC-CCCCCeEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTG-RHPGGLAGL 79 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~-~h~~~v~~v 79 (340)
+||+.+|+..+.|. +|...|.+++|+||.+ .+++|+.|.+|.+||+.... ..++.. .|.+-|.|+
T Consensus 89 lWDl~~g~~t~~f~----GH~~dVlsva~s~dn~---------qivSGSrDkTiklwnt~g~c-k~t~~~~~~~~WVscv 154 (315)
T KOG0279|consen 89 LWDLATGESTRRFV----GHTKDVLSVAFSTDNR---------QIVSGSRDKTIKLWNTLGVC-KYTIHEDSHREWVSCV 154 (315)
T ss_pred EEEecCCcEEEEEE----ecCCceEEEEecCCCc---------eeecCCCcceeeeeeecccE-EEEEecCCCcCcEEEE
Confidence 69999999999998 9999999999999998 89999999999999987664 444443 347889999
Q ss_pred EEecC--CCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCC
Q 036605 80 AFAKK--GRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDV 155 (340)
Q Consensus 80 ~~~~~--~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~ 155 (340)
+|+|+ ...+++++.|++|++||+++.+....+.+|...++.++++|||..+++++.+ +.+||+..++.+..+. |.
T Consensus 155 rfsP~~~~p~Ivs~s~DktvKvWnl~~~~l~~~~~gh~~~v~t~~vSpDGslcasGgkdg~~~LwdL~~~k~lysl~-a~ 233 (315)
T KOG0279|consen 155 RFSPNESNPIIVSASWDKTVKVWNLRNCQLRTTFIGHSGYVNTVTVSPDGSLCASGGKDGEAMLWDLNEGKNLYSLE-AF 233 (315)
T ss_pred EEcCCCCCcEEEEccCCceEEEEccCCcchhhccccccccEEEEEECCCCCEEecCCCCceEEEEEccCCceeEecc-CC
Confidence 99997 6789999999999999999999999999999999999999999999997766 9999999999877765 67
Q ss_pred CCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCC----CeeeeeecCCCCCCCCEEEEEeCCCcEE
Q 036605 156 GPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHS----PVAIDCKNSPNGEDGTVILAVAESGVAY 231 (340)
Q Consensus 156 ~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~----~~~~~~~~~~~~~~~~~l~~~s~dg~i~ 231 (340)
..|.+++|+|+...| +.+. +..|+|||+ .++..+..+.+....+ .....+.+.| +++|..|++|-.|+.|+
T Consensus 234 ~~v~sl~fspnrywL-~~at-~~sIkIwdl--~~~~~v~~l~~d~~g~s~~~~~~~clslaw-s~dG~tLf~g~td~~ir 308 (315)
T KOG0279|consen 234 DIVNSLCFSPNRYWL-CAAT-ATSIKIWDL--ESKAVVEELKLDGIGPSSKAGDPICLSLAW-SADGQTLFAGYTDNVIR 308 (315)
T ss_pred CeEeeEEecCCceeE-eecc-CCceEEEec--cchhhhhhccccccccccccCCcEEEEEEE-cCCCcEEEeeecCCcEE
Confidence 899999999987544 4466 678999999 4554444333322211 1233444477 89999999999999999
Q ss_pred EEECC
Q 036605 232 SWDLK 236 (340)
Q Consensus 232 vwd~~ 236 (340)
+|.+.
T Consensus 309 v~qv~ 313 (315)
T KOG0279|consen 309 VWQVA 313 (315)
T ss_pred EEEee
Confidence 99874
No 8
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=100.00 E-value=4.3e-32 Score=218.92 Aligned_cols=226 Identities=13% Similarity=0.193 Sum_probs=192.8
Q ss_pred CccCCCCcee-eeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEE
Q 036605 1 IWSTNDGSLL-AEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGL 79 (340)
Q Consensus 1 vwd~~~g~~~-~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v 79 (340)
+||+.+|+.+ ..+. +|...|++|+|.|-.. ...+.+||+++.||+|+|||+..+..+..+.+ |+.+|+|+
T Consensus 183 lwdpktg~~~g~~l~----gH~K~It~Lawep~hl----~p~~r~las~skDg~vrIWd~~~~~~~~~lsg-HT~~VTCv 253 (480)
T KOG0271|consen 183 LWDPKTGQQIGRALR----GHKKWITALAWEPLHL----VPPCRRLASSSKDGSVRIWDTKLGTCVRTLSG-HTASVTCV 253 (480)
T ss_pred EecCCCCCccccccc----CcccceeEEeeccccc----CCCccceecccCCCCEEEEEccCceEEEEecc-CccceEEE
Confidence 6999999876 4555 8999999999976532 11222899999999999999999999999998 99999999
Q ss_pred EEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEc-----------cCCC--------------------
Q 036605 80 AFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFL-----------CEEK-------------------- 128 (340)
Q Consensus 80 ~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~-----------~~~~-------------------- 128 (340)
+|-.+ .++|+++.|++|++|+...|....++++|...|+.++.+ |.++
T Consensus 254 rwGG~-gliySgS~DrtIkvw~a~dG~~~r~lkGHahwvN~lalsTdy~LRtgaf~~t~~~~~~~se~~~~Al~rY~~~~ 332 (480)
T KOG0271|consen 254 RWGGE-GLIYSGSQDRTIKVWRALDGKLCRELKGHAHWVNHLALSTDYVLRTGAFDHTGRKPKSFSEEQKKALERYEAVL 332 (480)
T ss_pred EEcCC-ceEEecCCCceEEEEEccchhHHHhhcccchheeeeeccchhhhhccccccccccCCChHHHHHHHHHHHHHhh
Confidence 99743 499999999999999999999999999999999999877 2233
Q ss_pred -----EEEEecCc--EEEEECC-CCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeee
Q 036605 129 -----IFALASSE--VRILSLE-NGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSM 200 (340)
Q Consensus 129 -----~l~~~~~~--i~i~d~~-~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~ 200 (340)
.+++++.+ +.+|+.. +.+++.+..+|..-|+.+.||||++|+++++. |..|++|+- .+++.+..+.
T Consensus 333 ~~~~erlVSgsDd~tlflW~p~~~kkpi~rmtgHq~lVn~V~fSPd~r~IASaSF-DkSVkLW~g--~tGk~lasfR--- 406 (480)
T KOG0271|consen 333 KDSGERLVSGSDDFTLFLWNPFKSKKPITRMTGHQALVNHVSFSPDGRYIASASF-DKSVKLWDG--RTGKFLASFR--- 406 (480)
T ss_pred ccCcceeEEecCCceEEEecccccccchhhhhchhhheeeEEECCCccEEEEeec-ccceeeeeC--CCcchhhhhh---
Confidence 47776555 9999864 44577888999999999999999999999988 999999998 5788888777
Q ss_pred cCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCC
Q 036605 201 RHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTN 245 (340)
Q Consensus 201 ~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~ 245 (340)
+|...++.+ .| +.|..+|++|+.|.++++|++.+.+....+.
T Consensus 407 GHv~~VYqv--aw-saDsRLlVS~SkDsTLKvw~V~tkKl~~DLp 448 (480)
T KOG0271|consen 407 GHVAAVYQV--AW-SADSRLLVSGSKDSTLKVWDVRTKKLKQDLP 448 (480)
T ss_pred hccceeEEE--Ee-ccCccEEEEcCCCceEEEEEeeeeeecccCC
Confidence 898888888 88 8999999999999999999999877665343
No 9
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=100.00 E-value=7.8e-31 Score=233.44 Aligned_cols=227 Identities=22% Similarity=0.289 Sum_probs=188.6
Q ss_pred CccCCCCc--eeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEc-cCCeeEEEecCCCCCCeE
Q 036605 1 IWSTNDGS--LLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDV-LTGEMKWKSTGRHPGGLA 77 (340)
Q Consensus 1 vwd~~~g~--~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~-~~~~~~~~~~~~h~~~v~ 77 (340)
+|++.++. ++.++. +|...|.+++|+|+++ ++++|+.|++|+|||+ ..+..+..+.+ |...|+
T Consensus 185 ~~~~~~~~~~~~~~l~----~h~~~v~~~~fs~d~~---------~l~s~s~D~tiriwd~~~~~~~~~~l~g-H~~~v~ 250 (456)
T KOG0266|consen 185 IWKLEGIKSNLLRELS----GHTRGVSDVAFSPDGS---------YLLSGSDDKTLRIWDLKDDGRNLKTLKG-HSTYVT 250 (456)
T ss_pred Eeecccccchhhcccc----ccccceeeeEECCCCc---------EEEEecCCceEEEeeccCCCeEEEEecC-CCCceE
Confidence 35665555 555553 8999999999999999 9999999999999999 55578889998 999999
Q ss_pred EEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCc--eeEEeec
Q 036605 78 GLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGE--EVLKFSD 153 (340)
Q Consensus 78 ~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~--~~~~~~~ 153 (340)
+++|+|+++.+++|+.|+.|++||+++++.+..+.+|...|++++|++++.++++++.+ |++||+.++. .+..+..
T Consensus 251 ~~~f~p~g~~i~Sgs~D~tvriWd~~~~~~~~~l~~hs~~is~~~f~~d~~~l~s~s~d~~i~vwd~~~~~~~~~~~~~~ 330 (456)
T KOG0266|consen 251 SVAFSPDGNLLVSGSDDGTVRIWDVRTGECVRKLKGHSDGISGLAFSPDGNLLVSASYDGTIRVWDLETGSKLCLKLLSG 330 (456)
T ss_pred EEEecCCCCEEEEecCCCcEEEEeccCCeEEEeeeccCCceEEEEECCCCCEEEEcCCCccEEEEECCCCceeeeecccC
Confidence 99999999999999999999999999999999999999999999999999999987655 9999999998 4566666
Q ss_pred CCCC--eEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEE
Q 036605 154 DVGP--LQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAY 231 (340)
Q Consensus 154 ~~~~--v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~ 231 (340)
+... ++.+.|+|++.+++++.. |+.+++||+ .......... .|.............+.+.++++|+.|+.|+
T Consensus 331 ~~~~~~~~~~~fsp~~~~ll~~~~-d~~~~~w~l--~~~~~~~~~~---~~~~~~~~~~~~~~~~~~~~i~sg~~d~~v~ 404 (456)
T KOG0266|consen 331 AENSAPVTSVQFSPNGKYLLSASL-DRTLKLWDL--RSGKSVGTYT---GHSNLVRCIFSPTLSTGGKLIYSGSEDGSVY 404 (456)
T ss_pred CCCCCceeEEEECCCCcEEEEecC-CCeEEEEEc--cCCcceeeec---ccCCcceeEecccccCCCCeEEEEeCCceEE
Confidence 6655 999999999999999888 999999999 3443333333 3333222222222378999999999999999
Q ss_pred EEECCCCCccCCCCCc
Q 036605 232 SWDLKTVSQDEKTNPA 247 (340)
Q Consensus 232 vwd~~~~~~~~~~~p~ 247 (340)
+|+..++..+..++.+
T Consensus 405 ~~~~~s~~~~~~l~~h 420 (456)
T KOG0266|consen 405 VWDSSSGGILQRLEGH 420 (456)
T ss_pred EEeCCccchhhhhcCC
Confidence 9999997777756555
No 10
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=100.00 E-value=6e-31 Score=228.82 Aligned_cols=219 Identities=18% Similarity=0.263 Sum_probs=185.6
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
||+..+...+.... +|...++|+++||||+ ++|+|+.||.|+|||...|-+..++.. |+..|+.+.
T Consensus 334 VweWqsEsYVlKQQ----gH~~~i~~l~YSpDgq---------~iaTG~eDgKVKvWn~~SgfC~vTFte-Hts~Vt~v~ 399 (893)
T KOG0291|consen 334 VWEWQSESYVLKQQ----GHSDRITSLAYSPDGQ---------LIATGAEDGKVKVWNTQSGFCFVTFTE-HTSGVTAVQ 399 (893)
T ss_pred EEEeeccceeeecc----ccccceeeEEECCCCc---------EEEeccCCCcEEEEeccCceEEEEecc-CCCceEEEE
Confidence 46665555444444 8999999999999999 999999999999999999999999999 999999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCC-CCeeEEEEccCCCEEEEecCc---EEEEECCCCceeEEeecCCC
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASE-KPISSSAFLCEEKIFALASSE---VRILSLENGEEVLKFSDDVG 156 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~-~~i~~l~~~~~~~~l~~~~~~---i~i~d~~~~~~~~~~~~~~~ 156 (340)
|+..|+.|++.+-||+|+.||+...+..++|.... ....|++..|.|..+..++.+ |++|++++|+.+-.+.+|++
T Consensus 400 f~~~g~~llssSLDGtVRAwDlkRYrNfRTft~P~p~QfscvavD~sGelV~AG~~d~F~IfvWS~qTGqllDiLsGHEg 479 (893)
T KOG0291|consen 400 FTARGNVLLSSSLDGTVRAWDLKRYRNFRTFTSPEPIQFSCVAVDPSGELVCAGAQDSFEIFVWSVQTGQLLDILSGHEG 479 (893)
T ss_pred EEecCCEEEEeecCCeEEeeeecccceeeeecCCCceeeeEEEEcCCCCEEEeeccceEEEEEEEeecCeeeehhcCCCC
Confidence 99999999999999999999999998888887543 346799999999999888777 99999999999999999999
Q ss_pred CeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECC
Q 036605 157 PLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 157 ~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
+|.+++|+|++..|++++. |.+|++||+=...+ . .-++.....+..+ .+ .|+|..|++++-||.|.+||.+
T Consensus 480 PVs~l~f~~~~~~LaS~SW-DkTVRiW~if~s~~-~----vEtl~i~sdvl~v--sf-rPdG~elaVaTldgqItf~d~~ 550 (893)
T KOG0291|consen 480 PVSGLSFSPDGSLLASGSW-DKTVRIWDIFSSSG-T----VETLEIRSDVLAV--SF-RPDGKELAVATLDGQITFFDIK 550 (893)
T ss_pred cceeeEEccccCeEEeccc-cceEEEEEeeccCc-e----eeeEeeccceeEE--EE-cCCCCeEEEEEecceEEEEEhh
Confidence 9999999999999999888 99999999831111 1 1112333334444 45 8999999999999999999998
Q ss_pred CCCccC
Q 036605 237 TVSQDE 242 (340)
Q Consensus 237 ~~~~~~ 242 (340)
...+..
T Consensus 551 ~~~q~~ 556 (893)
T KOG0291|consen 551 EAVQVG 556 (893)
T ss_pred hceeec
Confidence 866664
No 11
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=99.98 E-value=1.4e-30 Score=203.32 Aligned_cols=196 Identities=18% Similarity=0.225 Sum_probs=177.1
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEec-CCCEEEEEeCCCcE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAK-KGRSLHVVGTNGMA 97 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~-~~~~l~s~~~dg~i 97 (340)
+|..-+.|+.|-+|+. |++|+.|.+..+||+++|+....|.+ |.+.|.+++++| +++.+++|+.|+..
T Consensus 143 gHtgylScC~f~dD~~----------ilT~SGD~TCalWDie~g~~~~~f~G-H~gDV~slsl~p~~~ntFvSg~cD~~a 211 (343)
T KOG0286|consen 143 GHTGYLSCCRFLDDNH----------ILTGSGDMTCALWDIETGQQTQVFHG-HTGDVMSLSLSPSDGNTFVSGGCDKSA 211 (343)
T ss_pred CccceeEEEEEcCCCc----------eEecCCCceEEEEEcccceEEEEecC-CcccEEEEecCCCCCCeEEecccccce
Confidence 8999999999998777 99999999999999999999999998 999999999999 99999999999999
Q ss_pred EEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeec--CCCCeEEEEECCCCCEEEEE
Q 036605 98 SEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSD--DVGPLQYVSASDGAKIIITA 173 (340)
Q Consensus 98 ~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~--~~~~v~~~~~s~~~~~l~s~ 173 (340)
++||++.+..++.|.+|...|.++.|.|+|.-+++++.+ .++||++....+..|.. ...+|++++||-.|++|+++
T Consensus 212 klWD~R~~~c~qtF~ghesDINsv~ffP~G~afatGSDD~tcRlyDlRaD~~~a~ys~~~~~~gitSv~FS~SGRlLfag 291 (343)
T KOG0286|consen 212 KLWDVRSGQCVQTFEGHESDINSVRFFPSGDAFATGSDDATCRLYDLRADQELAVYSHDSIICGITSVAFSKSGRLLFAG 291 (343)
T ss_pred eeeeccCcceeEeecccccccceEEEccCCCeeeecCCCceeEEEeecCCcEEeeeccCcccCCceeEEEcccccEEEee
Confidence 999999999999999999999999999999999997766 99999999988877753 34789999999999999997
Q ss_pred EcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEE
Q 036605 174 GYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWD 234 (340)
Q Consensus 174 ~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd 234 (340)
.. |..+.+||. -.++....+. +|...+..+ .. +|||.-|++|+.|..++||.
T Consensus 292 y~-d~~c~vWDt--lk~e~vg~L~---GHeNRvScl--~~-s~DG~av~TgSWDs~lriW~ 343 (343)
T KOG0286|consen 292 YD-DFTCNVWDT--LKGERVGVLA---GHENRVSCL--GV-SPDGMAVATGSWDSTLRIWA 343 (343)
T ss_pred ec-CCceeEeec--cccceEEEee---ccCCeeEEE--EE-CCCCcEEEecchhHheeecC
Confidence 66 999999997 5555555555 888777655 44 89999999999999999994
No 12
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=99.97 E-value=1.6e-29 Score=197.45 Aligned_cols=221 Identities=12% Similarity=0.150 Sum_probs=184.6
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCC------eeEEEecCCCCC
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTG------EMKWKSTGRHPG 74 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~------~~~~~~~~~h~~ 74 (340)
|||.-+.....-+. -...-|..++|+|.+. ++|.|+-|....||++.+. +..+.+.+ |.+
T Consensus 81 vWDs~TtnK~haip----l~s~WVMtCA~sPSg~---------~VAcGGLdN~Csiy~ls~~d~~g~~~v~r~l~g-Htg 146 (343)
T KOG0286|consen 81 VWDSFTTNKVHAIP----LPSSWVMTCAYSPSGN---------FVACGGLDNKCSIYPLSTRDAEGNVRVSRELAG-HTG 146 (343)
T ss_pred EEEcccccceeEEe----cCceeEEEEEECCCCC---------eEEecCcCceeEEEecccccccccceeeeeecC-ccc
Confidence 68887777666665 4568899999999999 9999999999999999865 24456777 999
Q ss_pred CeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEcc-CCCEEEEecCc--EEEEECCCCceeEEe
Q 036605 75 GLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLC-EEKIFALASSE--VRILSLENGEEVLKF 151 (340)
Q Consensus 75 ~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~-~~~~l~~~~~~--i~i~d~~~~~~~~~~ 151 (340)
.+.|+.|-+ ...|++++.|.++.+||+++|+.+..|.+|.+.|.+++++| +++.+++++-+ .++||++.+...+.|
T Consensus 147 ylScC~f~d-D~~ilT~SGD~TCalWDie~g~~~~~f~GH~gDV~slsl~p~~~ntFvSg~cD~~aklWD~R~~~c~qtF 225 (343)
T KOG0286|consen 147 YLSCCRFLD-DNHILTGSGDMTCALWDIETGQQTQVFHGHTGDVMSLSLSPSDGNTFVSGGCDKSAKLWDVRSGQCVQTF 225 (343)
T ss_pred eeEEEEEcC-CCceEecCCCceEEEEEcccceEEEEecCCcccEEEEecCCCCCCeEEecccccceeeeeccCcceeEee
Confidence 999999987 56889999999999999999999999999999999999999 89999986555 999999999999999
Q ss_pred ecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeec-CCCCCCCCEEEEEeCCCcE
Q 036605 152 SDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKN-SPNGEDGTVILAVAESGVA 230 (340)
Q Consensus 152 ~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~~~~~l~~~s~dg~i 230 (340)
.+|...|+++.|.|+|.-|++++. |++.++||+| ..+++..+. ++.....+.. .| +..|++|++|..|..+
T Consensus 226 ~ghesDINsv~ffP~G~afatGSD-D~tcRlyDlR--aD~~~a~ys----~~~~~~gitSv~F-S~SGRlLfagy~d~~c 297 (343)
T KOG0286|consen 226 EGHESDINSVRFFPSGDAFATGSD-DATCRLYDLR--ADQELAVYS----HDSIICGITSVAF-SKSGRLLFAGYDDFTC 297 (343)
T ss_pred cccccccceEEEccCCCeeeecCC-CceeEEEeec--CCcEEeeec----cCcccCCceeEEE-cccccEEEeeecCCce
Confidence 999999999999999999999777 9999999996 333333332 2222222211 44 8899999999999999
Q ss_pred EEEECCCCCccCCC
Q 036605 231 YSWDLKTVSQDEKT 244 (340)
Q Consensus 231 ~vwd~~~~~~~~~~ 244 (340)
.+||.-.++....+
T Consensus 298 ~vWDtlk~e~vg~L 311 (343)
T KOG0286|consen 298 NVWDTLKGERVGVL 311 (343)
T ss_pred eEeeccccceEEEe
Confidence 99998776655533
No 13
>KOG0295 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.97 E-value=5.6e-31 Score=211.18 Aligned_cols=232 Identities=16% Similarity=0.198 Sum_probs=204.3
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC-CeeEEEecCCCCCCeEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT-GEMKWKSTGRHPGGLAGL 79 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~-~~~~~~~~~~h~~~v~~v 79 (340)
+||..+|++...++ +|...|..++|+..|+ +|++++.|=.+.+||..+ .+....+.+ |...|.++
T Consensus 134 v~D~~tg~~e~~Lr----GHt~sv~di~~~a~Gk---------~l~tcSsDl~~~LWd~~~~~~c~ks~~g-h~h~vS~V 199 (406)
T KOG0295|consen 134 VFDTETGELERSLR----GHTDSVFDISFDASGK---------YLATCSSDLSAKLWDFDTFFRCIKSLIG-HEHGVSSV 199 (406)
T ss_pred EEEccchhhhhhhh----ccccceeEEEEecCcc---------EEEecCCccchhheeHHHHHHHHHHhcC-cccceeeE
Confidence 59999999988888 8999999999999999 999999999999999887 345555666 99999999
Q ss_pred EEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCC
Q 036605 80 AFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGP 157 (340)
Q Consensus 80 ~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~ 157 (340)
+|-|.|.++++++.|.+|+.|++.+|..+.+|.+|..-|..++.+.||.++++++.+ +++|-+.++.....+..|..+
T Consensus 200 ~f~P~gd~ilS~srD~tik~We~~tg~cv~t~~~h~ewvr~v~v~~DGti~As~s~dqtl~vW~~~t~~~k~~lR~hEh~ 279 (406)
T KOG0295|consen 200 FFLPLGDHILSCSRDNTIKAWECDTGYCVKTFPGHSEWVRMVRVNQDGTIIASCSNDQTLRVWVVATKQCKAELREHEHP 279 (406)
T ss_pred EEEecCCeeeecccccceeEEecccceeEEeccCchHhEEEEEecCCeeEEEecCCCceEEEEEeccchhhhhhhccccc
Confidence 999999999999999999999999999999999999999999999999999998877 999999999888889999999
Q ss_pred eEEEEECCC---------------CCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEE
Q 036605 158 LQYVSASDG---------------AKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVIL 222 (340)
Q Consensus 158 v~~~~~s~~---------------~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~ 222 (340)
|.+++|.|. +.++.+++. |++|++||+ +++..+..+. +|..++..+ ++ +|.|+||+
T Consensus 280 vEci~wap~~~~~~i~~at~~~~~~~~l~s~Sr-DktIk~wdv--~tg~cL~tL~---ghdnwVr~~--af-~p~Gkyi~ 350 (406)
T KOG0295|consen 280 VECIAWAPESSYPSISEATGSTNGGQVLGSGSR-DKTIKIWDV--STGMCLFTLV---GHDNWVRGV--AF-SPGGKYIL 350 (406)
T ss_pred eEEEEecccccCcchhhccCCCCCccEEEeecc-cceEEEEec--cCCeEEEEEe---cccceeeee--EE-cCCCeEEE
Confidence 999999554 357777665 999999999 6776555555 899999888 88 89999999
Q ss_pred EEeCCCcEEEEECCCCCccCCCCCceEEEeecc
Q 036605 223 AVAESGVAYSWDLKTVSQDEKTNPAKITVKLKK 255 (340)
Q Consensus 223 ~~s~dg~i~vwd~~~~~~~~~~~p~~i~~~~~~ 255 (340)
++..|+++++||+++.+....+.++..-+...+
T Consensus 351 ScaDDktlrvwdl~~~~cmk~~~ah~hfvt~lD 383 (406)
T KOG0295|consen 351 SCADDKTLRVWDLKNLQCMKTLEAHEHFVTSLD 383 (406)
T ss_pred EEecCCcEEEEEeccceeeeccCCCcceeEEEe
Confidence 999999999999999998887877554444443
No 14
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=99.97 E-value=4.5e-30 Score=224.72 Aligned_cols=216 Identities=16% Similarity=0.215 Sum_probs=190.0
Q ss_pred eeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe-------------------------
Q 036605 9 LLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE------------------------- 63 (340)
Q Consensus 9 ~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~------------------------- 63 (340)
+.+++. .-...++|..|++|++ +||.|..|..|++|.+...+
T Consensus 370 c~YT~~----nt~~~v~ca~fSddss---------mlA~Gf~dS~i~~~Sl~p~kl~~lk~~~~l~~~d~~sad~~~~~~ 436 (707)
T KOG0263|consen 370 CMYTFH----NTYQGVTCAEFSDDSS---------MLACGFVDSSVRVWSLTPKKLKKLKDASDLSNIDTESADVDVDML 436 (707)
T ss_pred EEEEEE----EcCCcceeEeecCCcc---------hhhccccccEEEEEecchhhhccccchhhhccccccccchhhhhc
Confidence 345555 3457899999999999 99999999999999876311
Q ss_pred ------eEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc-
Q 036605 64 ------MKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE- 136 (340)
Q Consensus 64 ------~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~- 136 (340)
...++.+ |.++|..+.|+|+.++|++|+.|+++++|.+.+...+..+++|..+|+.+.|+|-|.++|+++++
T Consensus 437 D~~~~~~~~~L~G-H~GPVyg~sFsPd~rfLlScSED~svRLWsl~t~s~~V~y~GH~~PVwdV~F~P~GyYFatas~D~ 515 (707)
T KOG0263|consen 437 DDDSSGTSRTLYG-HSGPVYGCSFSPDRRFLLSCSEDSSVRLWSLDTWSCLVIYKGHLAPVWDVQFAPRGYYFATASHDQ 515 (707)
T ss_pred cccCCceeEEeec-CCCceeeeeecccccceeeccCCcceeeeecccceeEEEecCCCcceeeEEecCCceEEEecCCCc
Confidence 1233455 99999999999999999999999999999999999999999999999999999999999997666
Q ss_pred -EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCC
Q 036605 137 -VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNG 215 (340)
Q Consensus 137 -i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 215 (340)
.++|......+++.|.+|.+.|.++.|+|+..|+++++. |.++++||+ .++...+.+. +|...+..+ .+ +
T Consensus 516 tArLWs~d~~~PlRifaghlsDV~cv~FHPNs~Y~aTGSs-D~tVRlWDv--~~G~~VRiF~---GH~~~V~al--~~-S 586 (707)
T KOG0263|consen 516 TARLWSTDHNKPLRIFAGHLSDVDCVSFHPNSNYVATGSS-DRTVRLWDV--STGNSVRIFT---GHKGPVTAL--AF-S 586 (707)
T ss_pred eeeeeecccCCchhhhcccccccceEEECCcccccccCCC-CceEEEEEc--CCCcEEEEec---CCCCceEEE--EE-c
Confidence 999999999999999999999999999999999999877 999999999 6776666666 888888887 77 8
Q ss_pred CCCCEEEEEeCCCcEEEEECCCCCccCCCCCc
Q 036605 216 EDGTVILAVAESGVAYSWDLKTVSQDEKTNPA 247 (340)
Q Consensus 216 ~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p~ 247 (340)
|+|.+|++|+.||.|.+||+.++..+..+..+
T Consensus 587 p~Gr~LaSg~ed~~I~iWDl~~~~~v~~l~~H 618 (707)
T KOG0263|consen 587 PCGRYLASGDEDGLIKIWDLANGSLVKQLKGH 618 (707)
T ss_pred CCCceEeecccCCcEEEEEcCCCcchhhhhcc
Confidence 99999999999999999999998777655543
No 15
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.97 E-value=1.8e-29 Score=191.52 Aligned_cols=223 Identities=16% Similarity=0.196 Sum_probs=195.3
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
+||+..|.++.+|. +|..+|..++.+.|.. -+++|+.|..+.+||+.+|+..+++.+ |.+.|+.++
T Consensus 43 LWNp~rg~liktYs----ghG~EVlD~~~s~Dns---------kf~s~GgDk~v~vwDV~TGkv~Rr~rg-H~aqVNtV~ 108 (307)
T KOG0316|consen 43 LWNPLRGALIKTYS----GHGHEVLDAALSSDNS---------KFASCGGDKAVQVWDVNTGKVDRRFRG-HLAQVNTVR 108 (307)
T ss_pred eecccccceeeeec----CCCceeeecccccccc---------ccccCCCCceEEEEEcccCeeeeeccc-ccceeeEEE
Confidence 69999999999998 8999999999999986 699999999999999999999999999 999999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCC--eEEEEeecCCCCeeEEEEccCCCEEEEecCcEEEEECCCCceeEEeecCCCCe
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMG--EVIREFKASEKPISSSAFLCEEKIFALASSEVRILSLENGEEVLKFSDDVGPL 158 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~--~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~i~i~d~~~~~~~~~~~~~~~~v 158 (340)
|+.+...+++|+.|..+++||-++. ++++.+......|.++.+....-...+.+++++.||++.|.....+-+ .+|
T Consensus 109 fNeesSVv~SgsfD~s~r~wDCRS~s~ePiQildea~D~V~Si~v~~heIvaGS~DGtvRtydiR~G~l~sDy~g--~pi 186 (307)
T KOG0316|consen 109 FNEESSVVASGSFDSSVRLWDCRSRSFEPIQILDEAKDGVSSIDVAEHEIVAGSVDGTVRTYDIRKGTLSSDYFG--HPI 186 (307)
T ss_pred ecCcceEEEeccccceeEEEEcccCCCCccchhhhhcCceeEEEecccEEEeeccCCcEEEEEeecceeehhhcC--Ccc
Confidence 9999999999999999999998764 577778888889999988754433344778899999999977665554 579
Q ss_pred EEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 159 QYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 159 ~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
+++.|++|++..++++. |+++++.|- .+++.+.... +|....+.+.|++ ......+++|++||.|++||+...
T Consensus 187 t~vs~s~d~nc~La~~l-~stlrLlDk--~tGklL~sYk---Ghkn~eykldc~l-~qsdthV~sgSEDG~Vy~wdLvd~ 259 (307)
T KOG0316|consen 187 TSVSFSKDGNCSLASSL-DSTLRLLDK--ETGKLLKSYK---GHKNMEYKLDCCL-NQSDTHVFSGSEDGKVYFWDLVDE 259 (307)
T ss_pred eeEEecCCCCEEEEeec-cceeeeccc--chhHHHHHhc---ccccceeeeeeee-cccceeEEeccCCceEEEEEeccc
Confidence 99999999999999888 999999997 6788888887 8888888887888 677789999999999999999987
Q ss_pred CccCCCCC
Q 036605 239 SQDEKTNP 246 (340)
Q Consensus 239 ~~~~~~~p 246 (340)
.++..+..
T Consensus 260 ~~~sk~~~ 267 (307)
T KOG0316|consen 260 TQISKLSV 267 (307)
T ss_pred eeeeeecc
Confidence 77764443
No 16
>KOG0282 consensus mRNA splicing factor [Function unknown]
Probab=99.97 E-value=1.5e-30 Score=215.81 Aligned_cols=215 Identities=20% Similarity=0.312 Sum_probs=178.9
Q ss_pred CCCCCeEEEEeec-cccccccccCceEEEEEcCCCcEEEEEccC-CeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCc
Q 036605 19 EPVVSYSCLACGF-VGKKRRKERGTLLLALGTSNGDILAVDVLT-GEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGM 96 (340)
Q Consensus 19 ~~~~~v~~l~~sp-~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~-~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~ 96 (340)
+|...|+++.|.| .+. +|++|+.|+.|+||++-. +++++++.+ |..+|.+++|+.+|..+++++.|+.
T Consensus 212 gH~kgvsai~~fp~~~h---------LlLS~gmD~~vklW~vy~~~~~lrtf~g-H~k~Vrd~~~s~~g~~fLS~sfD~~ 281 (503)
T KOG0282|consen 212 GHTKGVSAIQWFPKKGH---------LLLSGGMDGLVKLWNVYDDRRCLRTFKG-HRKPVRDASFNNCGTSFLSASFDRF 281 (503)
T ss_pred CCccccchhhhccceee---------EEEecCCCceEEEEEEecCcceehhhhc-chhhhhhhhccccCCeeeeeeccee
Confidence 8999999999999 568 999999999999999987 789999999 9999999999999999999999999
Q ss_pred EEEEeCCCCeEEEEeecCCCCeeEEEEccCC-CEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEE
Q 036605 97 ASEMKSEMGEVIREFKASEKPISSSAFLCEE-KIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITA 173 (340)
Q Consensus 97 i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~-~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~ 173 (340)
|++||.++|+.+..|.. ...++|+.|+|++ +.+++|+.+ |+.||+++++.++.+..|-+.|..+.|-++|++++++
T Consensus 282 lKlwDtETG~~~~~f~~-~~~~~cvkf~pd~~n~fl~G~sd~ki~~wDiRs~kvvqeYd~hLg~i~~i~F~~~g~rFiss 360 (503)
T KOG0282|consen 282 LKLWDTETGQVLSRFHL-DKVPTCVKFHPDNQNIFLVGGSDKKIRQWDIRSGKVVQEYDRHLGAILDITFVDEGRRFISS 360 (503)
T ss_pred eeeeccccceEEEEEec-CCCceeeecCCCCCcEEEEecCCCcEEEEeccchHHHHHHHhhhhheeeeEEccCCceEeee
Confidence 99999999999998874 4567999999999 455554433 9999999999999999999999999999999999998
Q ss_pred EcCCCeEEEEEccCCCCCcc-------CCc---------------------eee-------------ecCCCeeeeeecC
Q 036605 174 GYGEKHLQVWRCDISSKTVN-------KGP---------------------ALS-------------MRHSPVAIDCKNS 212 (340)
Q Consensus 174 ~~~d~~i~iwd~~~~~~~~~-------~~~---------------------~~~-------------~~~~~~~~~~~~~ 212 (340)
+. |+.++||+.+....-.. ... .+. .+|...-..+.+.
T Consensus 361 SD-dks~riWe~~~~v~ik~i~~~~~hsmP~~~~~P~~~~~~aQs~dN~i~ifs~~~~~r~nkkK~feGh~vaGys~~v~ 439 (503)
T KOG0282|consen 361 SD-DKSVRIWENRIPVPIKNIADPEMHTMPCLTLHPNGKWFAAQSMDNYIAIFSTVPPFRLNKKKRFEGHSVAGYSCQVD 439 (503)
T ss_pred cc-CccEEEEEcCCCccchhhcchhhccCcceecCCCCCeehhhccCceEEEEecccccccCHhhhhcceeccCceeeEE
Confidence 88 99999999854321000 000 000 0222223334445
Q ss_pred CCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCC
Q 036605 213 PNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 213 ~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p 246 (340)
| +|||.+|++|+.||.+++||.++.+.+..++.
T Consensus 440 f-SpDG~~l~SGdsdG~v~~wdwkt~kl~~~lka 472 (503)
T KOG0282|consen 440 F-SPDGRTLCSGDSDGKVNFWDWKTTKLVSKLKA 472 (503)
T ss_pred E-cCCCCeEEeecCCccEEEeechhhhhhhcccc
Confidence 6 99999999999999999999999888876655
No 17
>PTZ00421 coronin; Provisional
Probab=99.97 E-value=3.5e-28 Score=215.89 Aligned_cols=207 Identities=14% Similarity=0.173 Sum_probs=165.3
Q ss_pred CCCCCeEEEEeec-cccccccccCceEEEEEcCCCcEEEEEccCCe-------eEEEecCCCCCCeEEEEEecCC-CEEE
Q 036605 19 EPVVSYSCLACGF-VGKKRRKERGTLLLALGTSNGDILAVDVLTGE-------MKWKSTGRHPGGLAGLAFAKKG-RSLH 89 (340)
Q Consensus 19 ~~~~~v~~l~~sp-~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~-------~~~~~~~~h~~~v~~v~~~~~~-~~l~ 89 (340)
+|...|++++|+| ++. +|++|+.||+|++||+.++. .+..+.+ |...|.+++|+|++ +.|+
T Consensus 73 GH~~~V~~v~fsP~d~~---------~LaSgS~DgtIkIWdi~~~~~~~~~~~~l~~L~g-H~~~V~~l~f~P~~~~iLa 142 (493)
T PTZ00421 73 GQEGPIIDVAFNPFDPQ---------KLFTASEDGTIMGWGIPEEGLTQNISDPIVHLQG-HTKKVGIVSFHPSAMNVLA 142 (493)
T ss_pred CCCCCEEEEEEcCCCCC---------EEEEEeCCCEEEEEecCCCccccccCcceEEecC-CCCcEEEEEeCcCCCCEEE
Confidence 7899999999999 778 89999999999999997652 3556777 99999999999975 6899
Q ss_pred EEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCC-eEEEEECCC
Q 036605 90 VVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGP-LQYVSASDG 166 (340)
Q Consensus 90 s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~-v~~~~~s~~ 166 (340)
+++.|+.|++||+.+++.+..+..|...|.+++|+|++.+|++++.+ |++||+++++.+..+.+|.+. +..+.|.++
T Consensus 143 Sgs~DgtVrIWDl~tg~~~~~l~~h~~~V~sla~spdG~lLatgs~Dg~IrIwD~rsg~~v~tl~~H~~~~~~~~~w~~~ 222 (493)
T PTZ00421 143 SAGADMVVNVWDVERGKAVEVIKCHSDQITSLEWNLDGSLLCTTSKDKKLNIIDPRDGTIVSSVEAHASAKSQRCLWAKR 222 (493)
T ss_pred EEeCCCEEEEEECCCCeEEEEEcCCCCceEEEEEECCCCEEEEecCCCEEEEEECCCCcEEEEEecCCCCcceEEEEcCC
Confidence 99999999999999999988899999999999999999999886655 999999999988888888765 456788888
Q ss_pred CCEEEEEEc---CCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEe-CCCcEEEEECCCCCcc
Q 036605 167 AKIIITAGY---GEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVA-ESGVAYSWDLKTVSQD 241 (340)
Q Consensus 167 ~~~l~s~~~---~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s-~dg~i~vwd~~~~~~~ 241 (340)
+..+++++. .|+.|++||++... .... ............ ..+ ++++.+|++++ .||.|++||+.++...
T Consensus 223 ~~~ivt~G~s~s~Dr~VklWDlr~~~-~p~~--~~~~d~~~~~~~--~~~-d~d~~~L~lggkgDg~Iriwdl~~~~~~ 295 (493)
T PTZ00421 223 KDLIITLGCSKSQQRQIMLWDTRKMA-SPYS--TVDLDQSSALFI--PFF-DEDTNLLYIGSKGEGNIRCFELMNERLT 295 (493)
T ss_pred CCeEEEEecCCCCCCeEEEEeCCCCC-Ccee--EeccCCCCceEE--EEE-cCCCCEEEEEEeCCCeEEEEEeeCCceE
Confidence 888887663 37999999985221 1111 111112122211 234 78888888877 5999999999875543
No 18
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=99.97 E-value=1e-28 Score=219.87 Aligned_cols=210 Identities=19% Similarity=0.271 Sum_probs=180.3
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe--eEEEecCCCCCCeEEEEEecCCCEEEEEeCCCc
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE--MKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGM 96 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~--~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~ 96 (340)
++...|+|+.|+|+|+ ++++++.++.+++|+..+++ ....+.+ |...|.+++|+|+++++++++.|++
T Consensus 157 ~~~~sv~~~~fs~~g~---------~l~~~~~~~~i~~~~~~~~~~~~~~~l~~-h~~~v~~~~fs~d~~~l~s~s~D~t 226 (456)
T KOG0266|consen 157 HECPSVTCVDFSPDGR---------ALAAASSDGLIRIWKLEGIKSNLLRELSG-HTRGVSDVAFSPDGSYLLSGSDDKT 226 (456)
T ss_pred cccCceEEEEEcCCCC---------eEEEccCCCcEEEeecccccchhhccccc-cccceeeeEECCCCcEEEEecCCce
Confidence 5578999999999999 99999999999999997777 6667766 9999999999999999999999999
Q ss_pred EEEEeC-CCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEE
Q 036605 97 ASEMKS-EMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITA 173 (340)
Q Consensus 97 i~~wd~-~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~ 173 (340)
|++||+ ..+..+..+.+|...|++++|+|+++++++++.+ |++||+++++.+..+.+|...|+.++|++++.+|+++
T Consensus 227 iriwd~~~~~~~~~~l~gH~~~v~~~~f~p~g~~i~Sgs~D~tvriWd~~~~~~~~~l~~hs~~is~~~f~~d~~~l~s~ 306 (456)
T KOG0266|consen 227 LRIWDLKDDGRNLKTLKGHSTYVTSVAFSPDGNLLVSGSDDGTVRIWDVRTGECVRKLKGHSDGISGLAFSPDGNLLVSA 306 (456)
T ss_pred EEEeeccCCCeEEEEecCCCCceEEEEecCCCCEEEEecCCCcEEEEeccCCeEEEeeeccCCceEEEEECCCCCEEEEc
Confidence 999999 5668889999999999999999999999887666 9999999999999999999999999999999999998
Q ss_pred EcCCCeEEEEEccCCCCCc--cCCceeeecCCCe--eeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCCc
Q 036605 174 GYGEKHLQVWRCDISSKTV--NKGPALSMRHSPV--AIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNPA 247 (340)
Q Consensus 174 ~~~d~~i~iwd~~~~~~~~--~~~~~~~~~~~~~--~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p~ 247 (340)
+. |+.|+|||+ .++.. ...+. .+... +..+ .| +|++.++++++.|+.+++||+..+.....+.+.
T Consensus 307 s~-d~~i~vwd~--~~~~~~~~~~~~---~~~~~~~~~~~--~f-sp~~~~ll~~~~d~~~~~w~l~~~~~~~~~~~~ 375 (456)
T KOG0266|consen 307 SY-DGTIRVWDL--ETGSKLCLKLLS---GAENSAPVTSV--QF-SPNGKYLLSASLDRTLKLWDLRSGKSVGTYTGH 375 (456)
T ss_pred CC-CccEEEEEC--CCCceeeeeccc---CCCCCCceeEE--EE-CCCCcEEEEecCCCeEEEEEccCCcceeeeccc
Confidence 77 999999999 44442 12222 22222 2222 44 899999999999999999999987766655553
No 19
>KOG0285 consensus Pleiotropic regulator 1 [RNA processing and modification]
Probab=99.97 E-value=3.7e-29 Score=200.50 Aligned_cols=217 Identities=13% Similarity=0.207 Sum_probs=191.7
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
|||+.+|++..+++ +|-..|..+++|+-.. ||++++.|+.|..||++..+.++.+.+ |-..|.|++
T Consensus 177 IwDlatg~Lkltlt----Ghi~~vr~vavS~rHp---------YlFs~gedk~VKCwDLe~nkvIR~YhG-HlS~V~~L~ 242 (460)
T KOG0285|consen 177 IWDLATGQLKLTLT----GHIETVRGVAVSKRHP---------YLFSAGEDKQVKCWDLEYNKVIRHYHG-HLSGVYCLD 242 (460)
T ss_pred EEEcccCeEEEeec----chhheeeeeeecccCc---------eEEEecCCCeeEEEechhhhhHHHhcc-ccceeEEEe
Confidence 79999999999998 8999999999998887 999999999999999999999999998 999999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCe
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPL 158 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v 158 (340)
.+|.-..|++|+.|.++++||+++...+..+.+|..+|.++.+.|-...+++++.+ |++||+..|+....+..|...+
T Consensus 243 lhPTldvl~t~grDst~RvWDiRtr~~V~~l~GH~~~V~~V~~~~~dpqvit~S~D~tvrlWDl~agkt~~tlt~hkksv 322 (460)
T KOG0285|consen 243 LHPTLDVLVTGGRDSTIRVWDIRTRASVHVLSGHTNPVASVMCQPTDPQVITGSHDSTVRLWDLRAGKTMITLTHHKKSV 322 (460)
T ss_pred ccccceeEEecCCcceEEEeeecccceEEEecCCCCcceeEEeecCCCceEEecCCceEEEeeeccCceeEeeeccccee
Confidence 99999999999999999999999999999999999999999999988888786655 9999999999999999999999
Q ss_pred EEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 159 QYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 159 ~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
.+++.+|....+++++. ..|+-|++ ..+.....+. +|...+..+ .. ....++++|+..|.+.+||.+++
T Consensus 323 ral~lhP~e~~fASas~--dnik~w~~--p~g~f~~nls---gh~~iintl--~~--nsD~v~~~G~dng~~~fwdwksg 391 (460)
T KOG0285|consen 323 RALCLHPKENLFASASP--DNIKQWKL--PEGEFLQNLS---GHNAIINTL--SV--NSDGVLVSGGDNGSIMFWDWKSG 391 (460)
T ss_pred eEEecCCchhhhhccCC--ccceeccC--Cccchhhccc---cccceeeee--ee--ccCceEEEcCCceEEEEEecCcC
Confidence 99999999877777544 67899999 6666666555 666666655 22 34467899999999999999986
Q ss_pred CccC
Q 036605 239 SQDE 242 (340)
Q Consensus 239 ~~~~ 242 (340)
....
T Consensus 392 ~nyQ 395 (460)
T KOG0285|consen 392 HNYQ 395 (460)
T ss_pred cccc
Confidence 5544
No 20
>KOG0285 consensus Pleiotropic regulator 1 [RNA processing and modification]
Probab=99.97 E-value=2.5e-29 Score=201.43 Aligned_cols=209 Identities=15% Similarity=0.200 Sum_probs=185.0
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcE
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMA 97 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i 97 (340)
.+|.+-|.|+++.|.+. +|++|+.|++|.|||+.+|++..++.+ |...|..+++++...+|++++.|+.|
T Consensus 148 ~gHlgWVr~vavdP~n~---------wf~tgs~DrtikIwDlatg~LkltltG-hi~~vr~vavS~rHpYlFs~gedk~V 217 (460)
T KOG0285|consen 148 SGHLGWVRSVAVDPGNE---------WFATGSADRTIKIWDLATGQLKLTLTG-HIETVRGVAVSKRHPYLFSAGEDKQV 217 (460)
T ss_pred hhccceEEEEeeCCCce---------eEEecCCCceeEEEEcccCeEEEeecc-hhheeeeeeecccCceEEEecCCCee
Confidence 48999999999999989 999999999999999999999999999 99999999999999999999999999
Q ss_pred EEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEc
Q 036605 98 SEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGY 175 (340)
Q Consensus 98 ~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~ 175 (340)
+.||++..+.++.+.+|-+.|.|++.+|.-..|++++++ +++||+++...+..+.+|..+|..+.+.|....+++++.
T Consensus 218 KCwDLe~nkvIR~YhGHlS~V~~L~lhPTldvl~t~grDst~RvWDiRtr~~V~~l~GH~~~V~~V~~~~~dpqvit~S~ 297 (460)
T KOG0285|consen 218 KCWDLEYNKVIRHYHGHLSGVYCLDLHPTLDVLVTGGRDSTIRVWDIRTRASVHVLSGHTNPVASVMCQPTDPQVITGSH 297 (460)
T ss_pred EEEechhhhhHHHhccccceeEEEeccccceeEEecCCcceEEEeeecccceEEEecCCCCcceeEEeecCCCceEEecC
Confidence 999999999999999999999999999999999998887 999999999999999999999999999998889999777
Q ss_pred CCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCC
Q 036605 176 GEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 176 ~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p 246 (340)
|++|++||++ .++...... .|...+..+ +. +|....+++++.|. |+-|++..+..+.++..
T Consensus 298 -D~tvrlWDl~--agkt~~tlt---~hkksvral--~l-hP~e~~fASas~dn-ik~w~~p~g~f~~nlsg 358 (460)
T KOG0285|consen 298 -DSTVRLWDLR--AGKTMITLT---HHKKSVRAL--CL-HPKENLFASASPDN-IKQWKLPEGEFLQNLSG 358 (460)
T ss_pred -CceEEEeeec--cCceeEeee---cccceeeEE--ec-CCchhhhhccCCcc-ceeccCCccchhhcccc
Confidence 9999999994 443333332 455555544 44 78878888888887 99999998877775443
No 21
>KOG0273 consensus Beta-transducin family (WD-40 repeat) protein [Chromatin structure and dynamics]
Probab=99.97 E-value=3.9e-29 Score=206.81 Aligned_cols=205 Identities=17% Similarity=0.250 Sum_probs=178.2
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEe
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMK 101 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd 101 (340)
..||+|+|+.+|. +||+|+.||.++||+.. |.++..+.. |.++|.++.|+.+|.+|++++.|+++.+||
T Consensus 236 kdVT~L~Wn~~G~---------~LatG~~~G~~riw~~~-G~l~~tl~~-HkgPI~slKWnk~G~yilS~~vD~ttilwd 304 (524)
T KOG0273|consen 236 KDVTSLDWNNDGT---------LLATGSEDGEARIWNKD-GNLISTLGQ-HKGPIFSLKWNKKGTYILSGGVDGTTILWD 304 (524)
T ss_pred CCcceEEecCCCC---------eEEEeecCcEEEEEecC-chhhhhhhc-cCCceEEEEEcCCCCEEEeccCCccEEEEe
Confidence 6799999999999 99999999999999954 667778887 999999999999999999999999999999
Q ss_pred CCCCeE-----------------------------------------EEEeecCCCCeeEEEEccCCCEEEEecCc--EE
Q 036605 102 SEMGEV-----------------------------------------IREFKASEKPISSSAFLCEEKIFALASSE--VR 138 (340)
Q Consensus 102 ~~~~~~-----------------------------------------~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~ 138 (340)
..+|.. +.++.+|..+|.++.|.|.+.+|++++.+ ++
T Consensus 305 ~~~g~~~q~f~~~s~~~lDVdW~~~~~F~ts~td~~i~V~kv~~~~P~~t~~GH~g~V~alk~n~tg~LLaS~SdD~Tlk 384 (524)
T KOG0273|consen 305 AHTGTVKQQFEFHSAPALDVDWQSNDEFATSSTDGCIHVCKVGEDRPVKTFIGHHGEVNALKWNPTGSLLASCSDDGTLK 384 (524)
T ss_pred ccCceEEEeeeeccCCccceEEecCceEeecCCCceEEEEEecCCCcceeeecccCceEEEEECCCCceEEEecCCCeeE
Confidence 865532 23456788999999999999999997665 99
Q ss_pred EEECCCCceeEEeecCCCCeEEEEECCC---------CCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeee
Q 036605 139 ILSLENGEEVLKFSDDVGPLQYVSASDG---------AKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDC 209 (340)
Q Consensus 139 i~d~~~~~~~~~~~~~~~~v~~~~~s~~---------~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~ 209 (340)
||..........+..|...|..+.|+|+ +..+++++. |++|++||+ ..+..+..+. .|...+.++
T Consensus 385 iWs~~~~~~~~~l~~Hskei~t~~wsp~g~v~~n~~~~~~l~sas~-dstV~lwdv--~~gv~i~~f~---kH~~pVysv 458 (524)
T KOG0273|consen 385 IWSMGQSNSVHDLQAHSKEIYTIKWSPTGPVTSNPNMNLMLASASF-DSTVKLWDV--ESGVPIHTLM---KHQEPVYSV 458 (524)
T ss_pred eeecCCCcchhhhhhhccceeeEeecCCCCccCCCcCCceEEEeec-CCeEEEEEc--cCCceeEeec---cCCCceEEE
Confidence 9999888888999999999999999987 446788777 999999999 5666655554 888888888
Q ss_pred ecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCC
Q 036605 210 KNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 210 ~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p 246 (340)
.| +|+|.++++|+.||.|.+|+.++++....++.
T Consensus 459 --af-S~~g~ylAsGs~dg~V~iws~~~~~l~~s~~~ 492 (524)
T KOG0273|consen 459 --AF-SPNGRYLASGSLDGCVHIWSTKTGKLVKSYQG 492 (524)
T ss_pred --Ee-cCCCcEEEecCCCCeeEeccccchheeEeecC
Confidence 77 89999999999999999999999887774444
No 22
>KOG0284 consensus Polyadenylation factor I complex, subunit PFS2 [RNA processing and modification]
Probab=99.97 E-value=4.5e-30 Score=208.84 Aligned_cols=210 Identities=11% Similarity=0.099 Sum_probs=182.1
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
.|+++|+++.|++++. ++++|..+|.|++|+..-. .+..+...|...|++++|+|....+++|+.||+|+
T Consensus 136 aHDs~Vr~m~ws~~g~---------wmiSgD~gG~iKyWqpnmn-nVk~~~ahh~eaIRdlafSpnDskF~t~SdDg~ik 205 (464)
T KOG0284|consen 136 AHDSPVRTMKWSHNGT---------WMISGDKGGMIKYWQPNMN-NVKIIQAHHAEAIRDLAFSPNDSKFLTCSDDGTIK 205 (464)
T ss_pred hhcccceeEEEccCCC---------EEEEcCCCceEEecccchh-hhHHhhHhhhhhhheeccCCCCceeEEecCCCeEE
Confidence 6999999999999999 9999999999999997644 45566664669999999999999999999999999
Q ss_pred EEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcC
Q 036605 99 EMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYG 176 (340)
Q Consensus 99 ~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~ 176 (340)
+||....+....+.+|...|.+++|+|....+++++.+ |++||.+++.++.++..|...|..+.|++++++|++++.
T Consensus 206 iWdf~~~kee~vL~GHgwdVksvdWHP~kgLiasgskDnlVKlWDprSg~cl~tlh~HKntVl~~~f~~n~N~Llt~sk- 284 (464)
T KOG0284|consen 206 IWDFRMPKEERVLRGHGWDVKSVDWHPTKGLIASGSKDNLVKLWDPRSGSCLATLHGHKNTVLAVKFNPNGNWLLTGSK- 284 (464)
T ss_pred EEeccCCchhheeccCCCCcceeccCCccceeEEccCCceeEeecCCCcchhhhhhhccceEEEEEEcCCCCeeEEccC-
Confidence 99999888888899999999999999999999998877 999999999999999999999999999999999999887
Q ss_pred CCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCC
Q 036605 177 EKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 177 d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p 246 (340)
|..+++||++ .-+.+..+. +|...+.++ .|..-....+.+|+.||.|..|.+...+.+..+.+
T Consensus 285 D~~~kv~DiR--~mkEl~~~r---~Hkkdv~~~--~WhP~~~~lftsgg~Dgsvvh~~v~~~~p~~~i~~ 347 (464)
T KOG0284|consen 285 DQSCKVFDIR--TMKELFTYR---GHKKDVTSL--TWHPLNESLFTSGGSDGSVVHWVVGLEEPLGEIPP 347 (464)
T ss_pred CceEEEEehh--HhHHHHHhh---cchhhheee--ccccccccceeeccCCCceEEEeccccccccCCCc
Confidence 9999999996 333333444 677777777 66445567789999999999999986666664555
No 23
>PTZ00420 coronin; Provisional
Probab=99.97 E-value=8.6e-28 Score=214.49 Aligned_cols=204 Identities=12% Similarity=0.141 Sum_probs=158.4
Q ss_pred CCCCCeEEEEeecc-ccccccccCceEEEEEcCCCcEEEEEccCCe--------eEEEecCCCCCCeEEEEEecCCCE-E
Q 036605 19 EPVVSYSCLACGFV-GKKRRKERGTLLLALGTSNGDILAVDVLTGE--------MKWKSTGRHPGGLAGLAFAKKGRS-L 88 (340)
Q Consensus 19 ~~~~~v~~l~~sp~-~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~--------~~~~~~~~h~~~v~~v~~~~~~~~-l 88 (340)
+|...|.+++|+|+ +. +||+|+.||+|++||+.++. .+..+.+ |...|.+++|+|++.. |
T Consensus 72 gH~~~V~~lafsP~~~~---------lLASgS~DgtIrIWDi~t~~~~~~~i~~p~~~L~g-H~~~V~sVaf~P~g~~iL 141 (568)
T PTZ00420 72 GHTSSILDLQFNPCFSE---------ILASGSEDLTIRVWEIPHNDESVKEIKDPQCILKG-HKKKISIIDWNPMNYYIM 141 (568)
T ss_pred CCCCCEEEEEEcCCCCC---------EEEEEeCCCeEEEEECCCCCccccccccceEEeec-CCCcEEEEEECCCCCeEE
Confidence 79999999999997 57 89999999999999997642 2335666 9999999999998875 5
Q ss_pred EEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEe--cCcEEEEECCCCceeEEeecCCCCeEEE-----
Q 036605 89 HVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALA--SSEVRILSLENGEEVLKFSDDVGPLQYV----- 161 (340)
Q Consensus 89 ~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~--~~~i~i~d~~~~~~~~~~~~~~~~v~~~----- 161 (340)
++++.|+.|++||+.+++.+..+. +...|.+++|+|+|.+|+++ ++.|++||+++++.+..+.+|.+.+...
T Consensus 142 aSgS~DgtIrIWDl~tg~~~~~i~-~~~~V~SlswspdG~lLat~s~D~~IrIwD~Rsg~~i~tl~gH~g~~~s~~v~~~ 220 (568)
T PTZ00420 142 CSSGFDSFVNIWDIENEKRAFQIN-MPKKLSSLKWNIKGNLLSGTCVGKHMHIIDPRKQEIASSFHIHDGGKNTKNIWID 220 (568)
T ss_pred EEEeCCCeEEEEECCCCcEEEEEe-cCCcEEEEEECCCCCEEEEEecCCEEEEEECCCCcEEEEEecccCCceeEEEEee
Confidence 789999999999999998777775 55789999999999999875 4459999999999999999998765432
Q ss_pred EECCCCCEEEEEEcCC---CeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 162 SASDGAKIIITAGYGE---KHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 162 ~~s~~~~~l~s~~~~d---~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
.|++++.+|++++..+ +.|+|||++. ....+. ...+.. ....+...+..+++.++++|+.|+.|++|++..+
T Consensus 221 ~fs~d~~~IlTtG~d~~~~R~VkLWDlr~-~~~pl~--~~~ld~--~~~~L~p~~D~~tg~l~lsGkGD~tIr~~e~~~~ 295 (568)
T PTZ00420 221 GLGGDDNYILSTGFSKNNMREMKLWDLKN-TTSALV--TMSIDN--ASAPLIPHYDESTGLIYLIGKGDGNCRYYQHSLG 295 (568)
T ss_pred eEcCCCCEEEEEEcCCCCccEEEEEECCC-CCCceE--EEEecC--CccceEEeeeCCCCCEEEEEECCCeEEEEEccCC
Confidence 3468889999988732 4799999952 222221 111122 1112222443667899999999999999998653
No 24
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=99.97 E-value=2e-28 Score=187.29 Aligned_cols=216 Identities=13% Similarity=0.179 Sum_probs=176.9
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe--eEEEecCCCCCCeEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE--MKWKSTGRHPGGLAG 78 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~--~~~~~~~~h~~~v~~ 78 (340)
+|...+|.+..++. |.++.|..|...|+++ +||+++. -.|++||+.+++ .+.++.+ |...|++
T Consensus 24 fWqa~tG~C~rTiq----h~dsqVNrLeiTpdk~---------~LAaa~~-qhvRlyD~~S~np~Pv~t~e~-h~kNVta 88 (311)
T KOG0315|consen 24 FWQALTGICSRTIQ----HPDSQVNRLEITPDKK---------DLAAAGN-QHVRLYDLNSNNPNPVATFEG-HTKNVTA 88 (311)
T ss_pred eeehhcCeEEEEEe----cCccceeeEEEcCCcc---------hhhhccC-CeeEEEEccCCCCCceeEEec-cCCceEE
Confidence 58999999999998 8889999999999999 7888764 479999999876 5778888 9999999
Q ss_pred EEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEe-ecCC
Q 036605 79 LAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKF-SDDV 155 (340)
Q Consensus 79 v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~-~~~~ 155 (340)
+.|..+|+++++|+.||++++||++.....+.+ .+..+|+++..+|+...|++++.. |++||+........+ ....
T Consensus 89 VgF~~dgrWMyTgseDgt~kIWdlR~~~~qR~~-~~~spVn~vvlhpnQteLis~dqsg~irvWDl~~~~c~~~liPe~~ 167 (311)
T KOG0315|consen 89 VGFQCDGRWMYTGSEDGTVKIWDLRSLSCQRNY-QHNSPVNTVVLHPNQTELISGDQSGNIRVWDLGENSCTHELIPEDD 167 (311)
T ss_pred EEEeecCeEEEecCCCceEEEEeccCcccchhc-cCCCCcceEEecCCcceEEeecCCCcEEEEEccCCccccccCCCCC
Confidence 999999999999999999999999985554445 467999999999999999998776 999999987655554 4445
Q ss_pred CCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccC---CceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEE
Q 036605 156 GPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNK---GPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYS 232 (340)
Q Consensus 156 ~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~---~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~v 232 (340)
..|.++...|||.+++.+.. .|..++|++- ...... ...--..|...+..+ .+ +|++++|+++|.|.+++|
T Consensus 168 ~~i~sl~v~~dgsml~a~nn-kG~cyvW~l~--~~~~~s~l~P~~k~~ah~~~il~C--~l-SPd~k~lat~ssdktv~i 241 (311)
T KOG0315|consen 168 TSIQSLTVMPDGSMLAAANN-KGNCYVWRLL--NHQTASELEPVHKFQAHNGHILRC--LL-SPDVKYLATCSSDKTVKI 241 (311)
T ss_pred cceeeEEEcCCCcEEEEecC-CccEEEEEcc--CCCccccceEhhheecccceEEEE--EE-CCCCcEEEeecCCceEEE
Confidence 78999999999999998766 9999999983 321111 111111344444444 66 899999999999999999
Q ss_pred EECCCC
Q 036605 233 WDLKTV 238 (340)
Q Consensus 233 wd~~~~ 238 (340)
|+..+.
T Consensus 242 wn~~~~ 247 (311)
T KOG0315|consen 242 WNTDDF 247 (311)
T ss_pred EecCCc
Confidence 998875
No 25
>KOG0281 consensus Beta-TrCP (transducin repeats containing)/Slimb proteins [Function unknown]
Probab=99.97 E-value=3.1e-30 Score=206.09 Aligned_cols=209 Identities=17% Similarity=0.208 Sum_probs=180.3
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
|||.++-++.+.+. +|++.|.|+.|. .+ .+++|+.|.+|++||+++|+++.++.+ |...|..+.
T Consensus 221 iWD~n~~~c~~~L~----GHtGSVLCLqyd--~r---------viisGSSDsTvrvWDv~tge~l~tlih-HceaVLhlr 284 (499)
T KOG0281|consen 221 IWDKNSLECLKILT----GHTGSVLCLQYD--ER---------VIVSGSSDSTVRVWDVNTGEPLNTLIH-HCEAVLHLR 284 (499)
T ss_pred EeccccHHHHHhhh----cCCCcEEeeecc--ce---------EEEecCCCceEEEEeccCCchhhHHhh-hcceeEEEE
Confidence 69998888888887 999999999996 56 899999999999999999999999998 999999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEE---EEeecCCCCeeEEEEccCCCEEEEecC--cEEEEECCCCceeEEeecCC
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVI---REFKASEKPISSSAFLCEEKIFALASS--EVRILSLENGEEVLKFSDDV 155 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~---~~~~~~~~~i~~l~~~~~~~~l~~~~~--~i~i~d~~~~~~~~~~~~~~ 155 (340)
|+ +.++++++.|.++.+||+.....+ +.+.+|...|..+.|+. ++++++++ +|++|++.+++.++.+.+|.
T Consensus 285 f~--ng~mvtcSkDrsiaVWdm~sps~it~rrVLvGHrAaVNvVdfd~--kyIVsASgDRTikvW~~st~efvRtl~gHk 360 (499)
T KOG0281|consen 285 FS--NGYMVTCSKDRSIAVWDMASPTDITLRRVLVGHRAAVNVVDFDD--KYIVSASGDRTIKVWSTSTCEFVRTLNGHK 360 (499)
T ss_pred Ee--CCEEEEecCCceeEEEeccCchHHHHHHHHhhhhhheeeecccc--ceEEEecCCceEEEEeccceeeehhhhccc
Confidence 98 679999999999999999765422 23678999999998874 47766544 49999999999999999999
Q ss_pred CCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEEC
Q 036605 156 GPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDL 235 (340)
Q Consensus 156 ~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~ 235 (340)
..|.++.+ .++++++|++ |.+|++||+ ..+..+..+. +|+..+..+ .-|...+++|+.||+|++||+
T Consensus 361 RGIAClQY--r~rlvVSGSS-DntIRlwdi--~~G~cLRvLe---GHEeLvRci-----RFd~krIVSGaYDGkikvWdl 427 (499)
T KOG0281|consen 361 RGIACLQY--RDRLVVSGSS-DNTIRLWDI--ECGACLRVLE---GHEELVRCI-----RFDNKRIVSGAYDGKIKVWDL 427 (499)
T ss_pred ccceehhc--cCeEEEecCC-CceEEEEec--cccHHHHHHh---chHHhhhhe-----eecCceeeeccccceEEEEec
Confidence 99999888 5678888777 999999999 6788777777 888887766 457789999999999999999
Q ss_pred CCCCccC
Q 036605 236 KTVSQDE 242 (340)
Q Consensus 236 ~~~~~~~ 242 (340)
.......
T Consensus 428 ~aaldpr 434 (499)
T KOG0281|consen 428 QAALDPR 434 (499)
T ss_pred ccccCCc
Confidence 8865543
No 26
>KOG0284 consensus Polyadenylation factor I complex, subunit PFS2 [RNA processing and modification]
Probab=99.97 E-value=3.8e-30 Score=209.23 Aligned_cols=203 Identities=8% Similarity=0.101 Sum_probs=179.7
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcE
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMA 97 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i 97 (340)
.+|...|+|++|||+.. -+++++.||+|+|||....+....+.+ |.-.|.++.|+|...+++++|.|..|
T Consensus 177 ahh~eaIRdlafSpnDs---------kF~t~SdDg~ikiWdf~~~kee~vL~G-HgwdVksvdWHP~kgLiasgskDnlV 246 (464)
T KOG0284|consen 177 AHHAEAIRDLAFSPNDS---------KFLTCSDDGTIKIWDFRMPKEERVLRG-HGWDVKSVDWHPTKGLIASGSKDNLV 246 (464)
T ss_pred HhhhhhhheeccCCCCc---------eeEEecCCCeEEEEeccCCchhheecc-CCCCcceeccCCccceeEEccCCcee
Confidence 37779999999999886 699999999999999998888888888 99999999999999999999999999
Q ss_pred EEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEc
Q 036605 98 SEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGY 175 (340)
Q Consensus 98 ~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~ 175 (340)
++||.++|..+.++..|+..|..+.|+|++++|++++.+ +++||+++.+.++.+++|...++++.|+|-..-|++.+.
T Consensus 247 KlWDprSg~cl~tlh~HKntVl~~~f~~n~N~Llt~skD~~~kv~DiR~mkEl~~~r~Hkkdv~~~~WhP~~~~lftsgg 326 (464)
T KOG0284|consen 247 KLWDPRSGSCLATLHGHKNTVLAVKFNPNGNWLLTGSKDQSCKVFDIRTMKELFTYRGHKKDVTSLTWHPLNESLFTSGG 326 (464)
T ss_pred EeecCCCcchhhhhhhccceEEEEEEcCCCCeeEEccCCceEEEEehhHhHHHHHhhcchhhheeeccccccccceeecc
Confidence 999999999999999999999999999999999998887 999999999999999999999999999998766666555
Q ss_pred CCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 176 GEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 176 ~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
.||.|..|.+. ..+ ........|...+.++ .| +|-|..|++|+.|..+++|.-..
T Consensus 327 ~Dgsvvh~~v~--~~~--p~~~i~~AHd~~iwsl--~~-hPlGhil~tgsnd~t~rfw~r~r 381 (464)
T KOG0284|consen 327 SDGSVVHWVVG--LEE--PLGEIPPAHDGEIWSL--AY-HPLGHILATGSNDRTVRFWTRNR 381 (464)
T ss_pred CCCceEEEecc--ccc--cccCCCcccccceeee--ec-cccceeEeecCCCcceeeeccCC
Confidence 59999999984 222 2223334677777777 77 89999999999999999997543
No 27
>KOG0294 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.97 E-value=1.4e-27 Score=188.54 Aligned_cols=203 Identities=17% Similarity=0.192 Sum_probs=159.4
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCC--EEEEEeCCCc
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGR--SLHVVGTNGM 96 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~--~l~s~~~dg~ 96 (340)
.|.++++|++.+ +. ++|+|+.|.+|+|||+.....+..+.. |.+.|+++.|.++-. .|++|+.||.
T Consensus 41 aH~~sitavAVs--~~---------~~aSGssDetI~IYDm~k~~qlg~ll~-HagsitaL~F~~~~S~shLlS~sdDG~ 108 (362)
T KOG0294|consen 41 AHAGSITALAVS--GP---------YVASGSSDETIHIYDMRKRKQLGILLS-HAGSITALKFYPPLSKSHLLSGSDDGH 108 (362)
T ss_pred ccccceeEEEec--ce---------eEeccCCCCcEEEEeccchhhhcceec-cccceEEEEecCCcchhheeeecCCCc
Confidence 789999999997 77 999999999999999999888888887 999999999998765 8999999999
Q ss_pred EEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCC--------
Q 036605 97 ASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDG-------- 166 (340)
Q Consensus 97 i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~-------- 166 (340)
|.+|+......+..+++|...|+.++++|.+++.++.+++ +++||+-.|+.-....- ....+.+.|+|.
T Consensus 109 i~iw~~~~W~~~~slK~H~~~Vt~lsiHPS~KLALsVg~D~~lr~WNLV~Gr~a~v~~L-~~~at~v~w~~~Gd~F~v~~ 187 (362)
T KOG0294|consen 109 IIIWRVGSWELLKSLKAHKGQVTDLSIHPSGKLALSVGGDQVLRTWNLVRGRVAFVLNL-KNKATLVSWSPQGDHFVVSG 187 (362)
T ss_pred EEEEEcCCeEEeeeecccccccceeEecCCCceEEEEcCCceeeeehhhcCccceeecc-CCcceeeEEcCCCCEEEEEe
Confidence 9999999999999999999999999999999998875555 99999988764433221 111122444444
Q ss_pred -------------------------------CCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCC
Q 036605 167 -------------------------------AKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNG 215 (340)
Q Consensus 167 -------------------------------~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 215 (340)
+.+|++|+. |+.|.+||.+ .......+ ..|+..+-++.... .
T Consensus 188 ~~~i~i~q~d~A~v~~~i~~~~r~l~~~~l~~~~L~vG~d-~~~i~~~D~d--s~~~~~~~---~AH~~RVK~i~~~~-~ 260 (362)
T KOG0294|consen 188 RNKIDIYQLDNASVFREIENPKRILCATFLDGSELLVGGD-NEWISLKDTD--SDTPLTEF---LAHENRVKDIASYT-N 260 (362)
T ss_pred ccEEEEEecccHhHhhhhhccccceeeeecCCceEEEecC-CceEEEeccC--CCccceee---ecchhheeeeEEEe-c
Confidence 345556555 6777777763 33222333 37777777774344 7
Q ss_pred CCCCEEEEEeCCCcEEEEECCCCCcc
Q 036605 216 EDGTVILAVAESGVAYSWDLKTVSQD 241 (340)
Q Consensus 216 ~~~~~l~~~s~dg~i~vwd~~~~~~~ 241 (340)
+++.+|+++++||.|+|||+......
T Consensus 261 ~~~~~lvTaSSDG~I~vWd~~~~~k~ 286 (362)
T KOG0294|consen 261 PEHEYLVTASSDGFIKVWDIDMETKK 286 (362)
T ss_pred CCceEEEEeccCceEEEEEccccccC
Confidence 88999999999999999999875444
No 28
>KOG0273 consensus Beta-transducin family (WD-40 repeat) protein [Chromatin structure and dynamics]
Probab=99.96 E-value=2.6e-28 Score=201.98 Aligned_cols=206 Identities=18% Similarity=0.268 Sum_probs=174.3
Q ss_pred CceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEE--------------------
Q 036605 7 GSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKW-------------------- 66 (340)
Q Consensus 7 g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~-------------------- 66 (340)
|.++..+. .|.++|.++.|+..|. ||++++.||++.+||..+|....
T Consensus 266 G~l~~tl~----~HkgPI~slKWnk~G~---------yilS~~vD~ttilwd~~~g~~~q~f~~~s~~~lDVdW~~~~~F 332 (524)
T KOG0273|consen 266 GNLISTLG----QHKGPIFSLKWNKKGT---------YILSGGVDGTTILWDAHTGTVKQQFEFHSAPALDVDWQSNDEF 332 (524)
T ss_pred chhhhhhh----ccCCceEEEEEcCCCC---------EEEeccCCccEEEEeccCceEEEeeeeccCCccceEEecCceE
Confidence 34444444 7999999999999999 99999999999999986655332
Q ss_pred ---------------------EecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEcc
Q 036605 67 ---------------------KSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLC 125 (340)
Q Consensus 67 ---------------------~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~ 125 (340)
++.+ |.+.|.++.|+|.+.+|++|+.|+++++|....+.....+.+|...|+.+.|+|
T Consensus 333 ~ts~td~~i~V~kv~~~~P~~t~~G-H~g~V~alk~n~tg~LLaS~SdD~TlkiWs~~~~~~~~~l~~Hskei~t~~wsp 411 (524)
T KOG0273|consen 333 ATSSTDGCIHVCKVGEDRPVKTFIG-HHGEVNALKWNPTGSLLASCSDDGTLKIWSMGQSNSVHDLQAHSKEIYTIKWSP 411 (524)
T ss_pred eecCCCceEEEEEecCCCcceeeec-ccCceEEEEECCCCceEEEecCCCeeEeeecCCCcchhhhhhhccceeeEeecC
Confidence 2245 999999999999999999999999999999998888899999999999999999
Q ss_pred CCC---------EEEEec--CcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccC
Q 036605 126 EEK---------IFALAS--SEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNK 194 (340)
Q Consensus 126 ~~~---------~l~~~~--~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~ 194 (340)
.|. .+++++ ..|++||+..+.++..|..|..+|.+++|+|+|+|+++++. |+.|.+|++ ..++..+
T Consensus 412 ~g~v~~n~~~~~~l~sas~dstV~lwdv~~gv~i~~f~kH~~pVysvafS~~g~ylAsGs~-dg~V~iws~--~~~~l~~ 488 (524)
T KOG0273|consen 412 TGPVTSNPNMNLMLASASFDSTVKLWDVESGVPIHTLMKHQEPVYSVAFSPNGRYLASGSL-DGCVHIWST--KTGKLVK 488 (524)
T ss_pred CCCccCCCcCCceEEEeecCCeEEEEEccCCceeEeeccCCCceEEEEecCCCcEEEecCC-CCeeEeccc--cchheeE
Confidence 763 455544 44999999999999999999999999999999999999887 999999998 4554433
Q ss_pred CceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECC
Q 036605 195 GPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 195 ~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
.. .....++.+ +| +.+|.+|.++..||.+++.|++
T Consensus 489 s~----~~~~~Ifel--~W-n~~G~kl~~~~sd~~vcvldlr 523 (524)
T KOG0273|consen 489 SY----QGTGGIFEL--CW-NAAGDKLGACASDGSVCVLDLR 523 (524)
T ss_pred ee----cCCCeEEEE--EE-cCCCCEEEEEecCCCceEEEec
Confidence 33 344556677 77 7888999999999999999875
No 29
>KOG0645 consensus WD40 repeat protein [General function prediction only]
Probab=99.96 E-value=1.6e-27 Score=184.44 Aligned_cols=201 Identities=15% Similarity=0.212 Sum_probs=169.1
Q ss_pred CCCCCeEEEEeecc-ccccccccCceEEEEEcCCCcEEEEEccCC---eeEEEecCCCCCCeEEEEEecCCCEEEEEeCC
Q 036605 19 EPVVSYSCLACGFV-GKKRRKERGTLLLALGTSNGDILAVDVLTG---EMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTN 94 (340)
Q Consensus 19 ~~~~~v~~l~~sp~-~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~---~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~d 94 (340)
+|.+++..++|+|- |. +||+|+.|..|++|+...+ .+...+..+|+..|+.++|+|.|++|++++.|
T Consensus 12 gh~~r~W~~awhp~~g~---------ilAscg~Dk~vriw~~~~~~s~~ck~vld~~hkrsVRsvAwsp~g~~La~aSFD 82 (312)
T KOG0645|consen 12 GHKDRVWSVAWHPGKGV---------ILASCGTDKAVRIWSTSSGDSWTCKTVLDDGHKRSVRSVAWSPHGRYLASASFD 82 (312)
T ss_pred CCCCcEEEEEeccCCce---------EEEeecCCceEEEEecCCCCcEEEEEeccccchheeeeeeecCCCcEEEEeecc
Confidence 78899999999998 78 8999999999999998853 34555666799999999999999999999999
Q ss_pred CcEEEEeCCCC--eEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCc---eeEEeecCCCCeEEEEECCCC
Q 036605 95 GMASEMKSEMG--EVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGE---EVLKFSDDVGPLQYVSASDGA 167 (340)
Q Consensus 95 g~i~~wd~~~~--~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~---~~~~~~~~~~~v~~~~~s~~~ 167 (340)
.++.+|.-..+ +.+..+.+|...|.+++|+++|.+||+++++ |.||....+. ....++.|...|..+.|+|..
T Consensus 83 ~t~~Iw~k~~~efecv~~lEGHEnEVK~Vaws~sG~~LATCSRDKSVWiWe~deddEfec~aVL~~HtqDVK~V~WHPt~ 162 (312)
T KOG0645|consen 83 ATVVIWKKEDGEFECVATLEGHENEVKCVAWSASGNYLATCSRDKSVWIWEIDEDDEFECIAVLQEHTQDVKHVIWHPTE 162 (312)
T ss_pred ceEEEeecCCCceeEEeeeeccccceeEEEEcCCCCEEEEeeCCCeEEEEEecCCCcEEEEeeeccccccccEEEEcCCc
Confidence 99999986644 5677799999999999999999999998887 9999987543 446779999999999999999
Q ss_pred CEEEEEEcCCCeEEEEEccCCCC--CccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECC
Q 036605 168 KIIITAGYGEKHLQVWRCDISSK--TVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 168 ~~l~s~~~~d~~i~iwd~~~~~~--~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
..|++++. |++|++|+-.. .. +....+. +|...+..+ .| .+.|..|++++.|+.++||...
T Consensus 163 dlL~S~SY-DnTIk~~~~~~-dddW~c~~tl~---g~~~TVW~~--~F-~~~G~rl~s~sdD~tv~Iw~~~ 225 (312)
T KOG0645|consen 163 DLLFSCSY-DNTIKVYRDED-DDDWECVQTLD---GHENTVWSL--AF-DNIGSRLVSCSDDGTVSIWRLY 225 (312)
T ss_pred ceeEEecc-CCeEEEEeecC-CCCeeEEEEec---CccceEEEE--Ee-cCCCceEEEecCCcceEeeeec
Confidence 99999888 99999998631 22 1222222 555555555 66 8899999999999999999865
No 30
>KOG0265 consensus U5 snRNP-specific protein-like factor and related proteins [RNA processing and modification]
Probab=99.96 E-value=1.6e-27 Score=186.95 Aligned_cols=223 Identities=17% Similarity=0.184 Sum_probs=169.5
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC-CeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCc
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT-GEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGM 96 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~-~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~ 96 (340)
.+|++.|..+.|+|+|. +||+|+.|..|.+|++.. -+..+.+.+ |.++|..+.|.+|++.+++++.|.+
T Consensus 44 ~gh~geI~~~~F~P~gs---------~~aSgG~Dr~I~LWnv~gdceN~~~lkg-HsgAVM~l~~~~d~s~i~S~gtDk~ 113 (338)
T KOG0265|consen 44 PGHKGEIYTIKFHPDGS---------CFASGGSDRAIVLWNVYGDCENFWVLKG-HSGAVMELHGMRDGSHILSCGTDKT 113 (338)
T ss_pred CCCcceEEEEEECCCCC---------eEeecCCcceEEEEeccccccceeeecc-ccceeEeeeeccCCCEEEEecCCce
Confidence 48999999999999999 999999999999999543 346677787 9999999999999999999999999
Q ss_pred EEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEE------------------------------------------EEe-
Q 036605 97 ASEMKSEMGEVIREFKASEKPISSSAFLCEEKIF------------------------------------------ALA- 133 (340)
Q Consensus 97 i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l------------------------------------------~~~- 133 (340)
|+.||+++|+...+++.|...+.++..+.-|..+ .++
T Consensus 114 v~~wD~~tG~~~rk~k~h~~~vNs~~p~rrg~~lv~SgsdD~t~kl~D~R~k~~~~t~~~kyqltAv~f~d~s~qv~sgg 193 (338)
T KOG0265|consen 114 VRGWDAETGKRIRKHKGHTSFVNSLDPSRRGPQLVCSGSDDGTLKLWDIRKKEAIKTFENKYQLTAVGFKDTSDQVISGG 193 (338)
T ss_pred EEEEecccceeeehhccccceeeecCccccCCeEEEecCCCceEEEEeecccchhhccccceeEEEEEecccccceeecc
Confidence 9999999999888777766665555433333333 222
Q ss_pred -cCcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeec--CCCeeeeee
Q 036605 134 -SSEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMR--HSPVAIDCK 210 (340)
Q Consensus 134 -~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~--~~~~~~~~~ 210 (340)
+++|++||++.+..+..+.+|..+|+.+..+++|.++++-+. |.++++||++.-.... +.+....+ |.-...-+.
T Consensus 194 Idn~ikvWd~r~~d~~~~lsGh~DtIt~lsls~~gs~llsnsM-d~tvrvwd~rp~~p~~-R~v~if~g~~hnfeknlL~ 271 (338)
T KOG0265|consen 194 IDNDIKVWDLRKNDGLYTLSGHADTITGLSLSRYGSFLLSNSM-DNTVRVWDVRPFAPSQ-RCVKIFQGHIHNFEKNLLK 271 (338)
T ss_pred ccCceeeeccccCcceEEeecccCceeeEEeccCCCccccccc-cceEEEEEecccCCCC-ceEEEeecchhhhhhhcce
Confidence 222566666666666777889999999999999999999777 9999999996433221 11111112 222334456
Q ss_pred cCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCCceEEEee
Q 036605 211 NSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNPAKITVKL 253 (340)
Q Consensus 211 ~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p~~i~~~~ 253 (340)
|+| +|++..+.+|+.|..+++||......+..+..+.-.+..
T Consensus 272 csw-sp~~~~i~ags~dr~vyvwd~~~r~~lyklpGh~gsvn~ 313 (338)
T KOG0265|consen 272 CSW-SPNGTKITAGSADRFVYVWDTTSRRILYKLPGHYGSVNE 313 (338)
T ss_pred eec-cCCCCccccccccceEEEeecccccEEEEcCCcceeEEE
Confidence 688 999999999999999999999887766633335444443
No 31
>KOG0295 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.96 E-value=7.3e-28 Score=193.39 Aligned_cols=198 Identities=15% Similarity=0.173 Sum_probs=175.2
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
+|+..|.+++|-|.|. ++++++.|.+|..|++.+|..+.++.+ |..-|..++.+.||..+++|+.|.+|+
T Consensus 191 gh~h~vS~V~f~P~gd---------~ilS~srD~tik~We~~tg~cv~t~~~-h~ewvr~v~v~~DGti~As~s~dqtl~ 260 (406)
T KOG0295|consen 191 GHEHGVSSVFFLPLGD---------HILSCSRDNTIKAWECDTGYCVKTFPG-HSEWVRMVRVNQDGTIIASCSNDQTLR 260 (406)
T ss_pred CcccceeeEEEEecCC---------eeeecccccceeEEecccceeEEeccC-chHhEEEEEecCCeeEEEecCCCceEE
Confidence 7899999999999998 999999999999999999999999999 999999999999999999999999999
Q ss_pred EEeCCCCeEEEEeecCCCCeeEEEEccC---------------CCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEE
Q 036605 99 EMKSEMGEVIREFKASEKPISSSAFLCE---------------EKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYV 161 (340)
Q Consensus 99 ~wd~~~~~~~~~~~~~~~~i~~l~~~~~---------------~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~ 161 (340)
+|-+.+++....+..|+.+|.+++|.|. ++++++++++ |++||+.++..+.++.+|.+.|..+
T Consensus 261 vW~~~t~~~k~~lR~hEh~vEci~wap~~~~~~i~~at~~~~~~~~l~s~SrDktIk~wdv~tg~cL~tL~ghdnwVr~~ 340 (406)
T KOG0295|consen 261 VWVVATKQCKAELREHEHPVECIAWAPESSYPSISEATGSTNGGQVLGSGSRDKTIKIWDVSTGMCLFTLVGHDNWVRGV 340 (406)
T ss_pred EEEeccchhhhhhhccccceEEEEecccccCcchhhccCCCCCccEEEeecccceEEEEeccCCeEEEEEecccceeeee
Confidence 9999999888889999999999999763 2466666555 9999999999999999999999999
Q ss_pred EECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEEC
Q 036605 162 SASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDL 235 (340)
Q Consensus 162 ~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~ 235 (340)
+|+|.|+||+++++ |+++++||+ ..++...... .|+..+..+ .+ +.+..++++|+-|..+++|..
T Consensus 341 af~p~Gkyi~ScaD-Dktlrvwdl--~~~~cmk~~~---ah~hfvt~l--Df-h~~~p~VvTGsVdqt~KvwEc 405 (406)
T KOG0295|consen 341 AFSPGGKYILSCAD-DKTLRVWDL--KNLQCMKTLE---AHEHFVTSL--DF-HKTAPYVVTGSVDQTVKVWEC 405 (406)
T ss_pred EEcCCCeEEEEEec-CCcEEEEEe--ccceeeeccC---CCcceeEEE--ec-CCCCceEEeccccceeeeeec
Confidence 99999999999998 999999999 4555544444 455454444 44 667779999999999999964
No 32
>KOG0276 consensus Vesicle coat complex COPI, beta' subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.96 E-value=9.4e-28 Score=205.11 Aligned_cols=222 Identities=15% Similarity=0.167 Sum_probs=192.8
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
|||.++..+...+. -.+.+|.+..|-+-.. .+++|+.|..|+||+..+++.++.|.. |.+.|.+++
T Consensus 39 IWnyetqtmVksfe----V~~~PvRa~kfiaRkn---------Wiv~GsDD~~IrVfnynt~ekV~~FeA-H~DyIR~ia 104 (794)
T KOG0276|consen 39 IWNYETQTMVKSFE----VSEVPVRAAKFIARKN---------WIVTGSDDMQIRVFNYNTGEKVKTFEA-HSDYIRSIA 104 (794)
T ss_pred EEecccceeeeeee----ecccchhhheeeeccc---------eEEEecCCceEEEEecccceeeEEeec-cccceeeee
Confidence 69999998888887 5678999999987777 999999999999999999999999998 999999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCC-eEEEEeecCCCCeeEEEEccC-CCEEEE--ecCcEEEEECCCCceeEEeecCCC
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMG-EVIREFKASEKPISSSAFLCE-EKIFAL--ASSEVRILSLENGEEVLKFSDDVG 156 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~-~~~~~~~~~~~~i~~l~~~~~-~~~l~~--~~~~i~i~d~~~~~~~~~~~~~~~ 156 (340)
.+|...+++++++|-.|++||.+.. ...+.|.+|..-|.+++|.|. ...+++ -|++|++|.+.+..+..++.+|..
T Consensus 105 vHPt~P~vLtsSDDm~iKlW~we~~wa~~qtfeGH~HyVMqv~fnPkD~ntFaS~sLDrTVKVWslgs~~~nfTl~gHek 184 (794)
T KOG0276|consen 105 VHPTLPYVLTSSDDMTIKLWDWENEWACEQTFEGHEHYVMQVAFNPKDPNTFASASLDRTVKVWSLGSPHPNFTLEGHEK 184 (794)
T ss_pred ecCCCCeEEecCCccEEEEeeccCceeeeeEEcCcceEEEEEEecCCCccceeeeeccccEEEEEcCCCCCceeeecccc
Confidence 9999999999999999999999865 456779999999999999995 456666 466699999999999999999999
Q ss_pred CeEEEEECC--CCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEE
Q 036605 157 PLQYVSASD--GAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWD 234 (340)
Q Consensus 157 ~v~~~~~s~--~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd 234 (340)
.|+++.|-+ |..||++++. |.+++|||. +++.....+. +|...+..+ +| +|.-..+++|++||+++||+
T Consensus 185 GVN~Vdyy~~gdkpylIsgaD-D~tiKvWDy--Qtk~CV~TLe---GHt~Nvs~v--~f-hp~lpiiisgsEDGTvriWh 255 (794)
T KOG0276|consen 185 GVNCVDYYTGGDKPYLISGAD-DLTIKVWDY--QTKSCVQTLE---GHTNNVSFV--FF-HPELPIIISGSEDGTVRIWN 255 (794)
T ss_pred CcceEEeccCCCcceEEecCC-CceEEEeec--chHHHHHHhh---cccccceEE--Ee-cCCCcEEEEecCCccEEEec
Confidence 999999965 4579999888 999999999 6666666666 776666555 56 88999999999999999999
Q ss_pred CCCCCccCCCC
Q 036605 235 LKTVSQDEKTN 245 (340)
Q Consensus 235 ~~~~~~~~~~~ 245 (340)
..+.++...+.
T Consensus 256 s~Ty~lE~tLn 266 (794)
T KOG0276|consen 256 SKTYKLEKTLN 266 (794)
T ss_pred Ccceehhhhhh
Confidence 98876655443
No 33
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=99.96 E-value=5.9e-26 Score=190.95 Aligned_cols=219 Identities=21% Similarity=0.319 Sum_probs=183.8
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
+||..+++....+. .|...+.++.|+|+++ ++++++.+|.|.+||+.+++....+.. |...|.++.
T Consensus 35 i~~~~~~~~~~~~~----~~~~~i~~~~~~~~~~---------~l~~~~~~~~i~i~~~~~~~~~~~~~~-~~~~i~~~~ 100 (289)
T cd00200 35 VWDLETGELLRTLK----GHTGPVRDVAASADGT---------YLASGSSDKTIRLWDLETGECVRTLTG-HTSYVSSVA 100 (289)
T ss_pred EEEeeCCCcEEEEe----cCCcceeEEEECCCCC---------EEEEEcCCCeEEEEEcCcccceEEEec-cCCcEEEEE
Confidence 57887777666666 6788899999999998 899999999999999998887878887 888999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEe--cCcEEEEECCCCceeEEeecCCCCe
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALA--SSEVRILSLENGEEVLKFSDDVGPL 158 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~--~~~i~i~d~~~~~~~~~~~~~~~~v 158 (340)
|++++..+++++.|+.|.+||+.+++....+..|...+.+++++|++.+++++ ++.|++||+.+++.+..+..|...+
T Consensus 101 ~~~~~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~l~~~~~~~~i~i~d~~~~~~~~~~~~~~~~i 180 (289)
T cd00200 101 FSPDGRILSSSSRDKTIKVWDVETGKCLTTLRGHTDWVNSVAFSPDGTFVASSSQDGTIKLWDLRTGKCVATLTGHTGEV 180 (289)
T ss_pred EcCCCCEEEEecCCCeEEEEECCCcEEEEEeccCCCcEEEEEEcCcCCEEEEEcCCCcEEEEEccccccceeEecCcccc
Confidence 99998888888889999999999998888888888899999999999988886 4559999999988888888898999
Q ss_pred EEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 159 QYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 159 ~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
.++.|+|++..+++++. ++.|++||++ .++....+. .+...+..+ .+ ++++.++++++.||.|++|++.++
T Consensus 181 ~~~~~~~~~~~l~~~~~-~~~i~i~d~~--~~~~~~~~~---~~~~~i~~~--~~-~~~~~~~~~~~~~~~i~i~~~~~~ 251 (289)
T cd00200 181 NSVAFSPDGEKLLSSSS-DGTIKLWDLS--TGKCLGTLR---GHENGVNSV--AF-SPDGYLLASGSEDGTIRVWDLRTG 251 (289)
T ss_pred ceEEECCCcCEEEEecC-CCcEEEEECC--CCceecchh---hcCCceEEE--EE-cCCCcEEEEEcCCCcEEEEEcCCc
Confidence 99999999999999887 9999999984 333333332 344344444 44 677888888888999999999875
Q ss_pred CccC
Q 036605 239 SQDE 242 (340)
Q Consensus 239 ~~~~ 242 (340)
+...
T Consensus 252 ~~~~ 255 (289)
T cd00200 252 ECVQ 255 (289)
T ss_pred eeEE
Confidence 5444
No 34
>KOG0293 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.96 E-value=3.8e-27 Score=192.23 Aligned_cols=245 Identities=14% Similarity=0.155 Sum_probs=195.3
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
+|..+|..+.||||.+ +|++++.+..+.+||+.+|...+.+..+|...+.+++|.|||..+++|+.|+.|.
T Consensus 267 gh~~~V~yi~wSPDdr---------yLlaCg~~e~~~lwDv~tgd~~~~y~~~~~~S~~sc~W~pDg~~~V~Gs~dr~i~ 337 (519)
T KOG0293|consen 267 GHSQPVSYIMWSPDDR---------YLLACGFDEVLSLWDVDTGDLRHLYPSGLGFSVSSCAWCPDGFRFVTGSPDRTII 337 (519)
T ss_pred cccCceEEEEECCCCC---------eEEecCchHheeeccCCcchhhhhcccCcCCCcceeEEccCCceeEecCCCCcEE
Confidence 8999999999999999 9999999999999999999988888765678899999999999999999999999
Q ss_pred EEeCCCCeEEEEeecCC-CCeeEEEEccCCCEEEEecC--cEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEc
Q 036605 99 EMKSEMGEVIREFKASE-KPISSSAFLCEEKIFALASS--EVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGY 175 (340)
Q Consensus 99 ~wd~~~~~~~~~~~~~~-~~i~~l~~~~~~~~l~~~~~--~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~ 175 (340)
.||+. |+.+..+++-. ..|.++++++||+++++.+. .|++|+.++......+ ....+|++...|.+++++++.-.
T Consensus 338 ~wdlD-gn~~~~W~gvr~~~v~dlait~Dgk~vl~v~~d~~i~l~~~e~~~dr~li-se~~~its~~iS~d~k~~LvnL~ 415 (519)
T KOG0293|consen 338 MWDLD-GNILGNWEGVRDPKVHDLAITYDGKYVLLVTVDKKIRLYNREARVDRGLI-SEEQPITSFSISKDGKLALVNLQ 415 (519)
T ss_pred EecCC-cchhhcccccccceeEEEEEcCCCcEEEEEecccceeeechhhhhhhccc-cccCceeEEEEcCCCcEEEEEcc
Confidence 99986 56666676544 35899999999999877444 4999998876444333 34578999999999999999666
Q ss_pred CCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCCceEEEeecc
Q 036605 176 GEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNPAKITVKLKK 255 (340)
Q Consensus 176 ~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p~~i~~~~~~ 255 (340)
+..+++||+ ........+. +|....+.+.+||...+..++++||+|+.|+||+..+++.+..+..+...+.
T Consensus 416 -~qei~LWDl--~e~~lv~kY~---Ghkq~~fiIrSCFgg~~~~fiaSGSED~kvyIWhr~sgkll~~LsGHs~~vN--- 486 (519)
T KOG0293|consen 416 -DQEIHLWDL--EENKLVRKYF---GHKQGHFIIRSCFGGGNDKFIASGSEDSKVYIWHRISGKLLAVLSGHSKTVN--- 486 (519)
T ss_pred -cCeeEEeec--chhhHHHHhh---cccccceEEEeccCCCCcceEEecCCCceEEEEEccCCceeEeecCCcceee---
Confidence 999999999 4444444444 7777777777788777889999999999999999999998886665432222
Q ss_pred cccccccccccccccceeeeeecccccCCCeEEEecCCc
Q 036605 256 ADADQQNSVNVKKSRTSIIAARLNDLEADGQKTITGLHD 294 (340)
Q Consensus 256 ~~~~~~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~~~~~ 294 (340)
-+...|..+.++| +...|+++.++...+
T Consensus 487 -------cVswNP~~p~m~A----SasDDgtIRIWg~~~ 514 (519)
T KOG0293|consen 487 -------CVSWNPADPEMFA----SASDDGTIRIWGPSD 514 (519)
T ss_pred -------EEecCCCCHHHhh----ccCCCCeEEEecCCc
Confidence 1124444444443 445899999997665
No 35
>KOG0275 consensus Conserved WD40 repeat-containing protein [General function prediction only]
Probab=99.95 E-value=1.6e-28 Score=194.71 Aligned_cols=213 Identities=19% Similarity=0.271 Sum_probs=174.4
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecC-------CCCCCeEEEEEecCCCEEEE
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTG-------RHPGGLAGLAFAKKGRSLHV 90 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~-------~h~~~v~~v~~~~~~~~l~s 90 (340)
.+..+-+.|..|||||. ||++|+.||-|.+||..+|+....++. -+..+|.|++|+.|...|++
T Consensus 210 Fg~KSh~EcA~FSPDgq---------yLvsgSvDGFiEVWny~~GKlrKDLkYQAqd~fMMmd~aVlci~FSRDsEMlAs 280 (508)
T KOG0275|consen 210 FGQKSHVECARFSPDGQ---------YLVSGSVDGFIEVWNYTTGKLRKDLKYQAQDNFMMMDDAVLCISFSRDSEMLAS 280 (508)
T ss_pred cccccchhheeeCCCCc---------eEeeccccceeeeehhccchhhhhhhhhhhcceeecccceEEEeecccHHHhhc
Confidence 45667789999999999 999999999999999999986554432 26779999999999999999
Q ss_pred EeCCCcEEEEeCCCCeEEEEee-cCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCC
Q 036605 91 VGTNGMASEMKSEMGEVIREFK-ASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGA 167 (340)
Q Consensus 91 ~~~dg~i~~wd~~~~~~~~~~~-~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~ 167 (340)
|+.||.|++|.+.+|..++.|. +|...|+|+.|+.|+..+++++.+ +++.-+++|+.+..|.+|.+.|+...|.+||
T Consensus 281 GsqDGkIKvWri~tG~ClRrFdrAHtkGvt~l~FSrD~SqiLS~sfD~tvRiHGlKSGK~LKEfrGHsSyvn~a~ft~dG 360 (508)
T KOG0275|consen 281 GSQDGKIKVWRIETGQCLRRFDRAHTKGVTCLSFSRDNSQILSASFDQTVRIHGLKSGKCLKEFRGHSSYVNEATFTDDG 360 (508)
T ss_pred cCcCCcEEEEEEecchHHHHhhhhhccCeeEEEEccCcchhhcccccceEEEeccccchhHHHhcCccccccceEEcCCC
Confidence 9999999999999999999987 899999999999999999887665 9999999999999999999999999999999
Q ss_pred CEEEEEEcCCCeEEEEEccCCCCCccCCce-----------eeec-CCCe------------------ee----------
Q 036605 168 KIIITAGYGEKHLQVWRCDISSKTVNKGPA-----------LSMR-HSPV------------------AI---------- 207 (340)
Q Consensus 168 ~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~-----------~~~~-~~~~------------------~~---------- 207 (340)
.++++++. ||+|+||+.. +.+....+. ..+. .++. +.
T Consensus 361 ~~iisaSs-DgtvkvW~~K--tteC~~Tfk~~~~d~~vnsv~~~PKnpeh~iVCNrsntv~imn~qGQvVrsfsSGkREg 437 (508)
T KOG0275|consen 361 HHIISASS-DGTVKVWHGK--TTECLSTFKPLGTDYPVNSVILLPKNPEHFIVCNRSNTVYIMNMQGQVVRSFSSGKREG 437 (508)
T ss_pred CeEEEecC-CccEEEecCc--chhhhhhccCCCCcccceeEEEcCCCCceEEEEcCCCeEEEEeccceEEeeeccCCccC
Confidence 99999888 9999999973 322111100 0000 0000 00
Q ss_pred -eeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 208 -DCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 208 -~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
++.++..+|.|.++++.+.|+.++.|.+.++....
T Consensus 438 GdFi~~~lSpkGewiYcigED~vlYCF~~~sG~LE~ 473 (508)
T KOG0275|consen 438 GDFINAILSPKGEWIYCIGEDGVLYCFSVLSGKLER 473 (508)
T ss_pred CceEEEEecCCCcEEEEEccCcEEEEEEeecCceee
Confidence 11112228899999999999999999999887766
No 36
>KOG0319 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.95 E-value=2.7e-27 Score=205.79 Aligned_cols=202 Identities=13% Similarity=0.141 Sum_probs=177.9
Q ss_pred CCCCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCee---EEEe-----cCCCCCCeEEEEEecCCCEE
Q 036605 18 GEPVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGEM---KWKS-----TGRHPGGLAGLAFAKKGRSL 88 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~---~~~~-----~~~h~~~v~~v~~~~~~~~l 88 (340)
.+|...|.+++++..+ . +|++++.|++|++|++...+. ...+ ...|...|++++.+|+.+++
T Consensus 408 ~gH~~svgava~~~~~as---------ffvsvS~D~tlK~W~l~~s~~~~~~~~~~~~~t~~aHdKdIN~Vaia~ndkLi 478 (775)
T KOG0319|consen 408 NGHTNSVGAVAGSKLGAS---------FFVSVSQDCTLKLWDLPKSKETAFPIVLTCRYTERAHDKDINCVAIAPNDKLI 478 (775)
T ss_pred cccccccceeeecccCcc---------EEEEecCCceEEEecCCCcccccccceehhhHHHHhhcccccceEecCCCceE
Confidence 3899999999997766 5 999999999999999876221 1111 12599999999999999999
Q ss_pred EEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCC
Q 036605 89 HVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDG 166 (340)
Q Consensus 89 ~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~ 166 (340)
+|||.|.+.++|+++.......+.+|...+.++.|+|..+.+++++++ |+||.+.+..++.+|.+|...|..+.|-.+
T Consensus 479 AT~SqDktaKiW~le~~~l~~vLsGH~RGvw~V~Fs~~dq~laT~SgD~TvKIW~is~fSClkT~eGH~~aVlra~F~~~ 558 (775)
T KOG0319|consen 479 ATGSQDKTAKIWDLEQLRLLGVLSGHTRGVWCVSFSKNDQLLATCSGDKTVKIWSISTFSCLKTFEGHTSAVLRASFIRN 558 (775)
T ss_pred EecccccceeeecccCceEEEEeeCCccceEEEEeccccceeEeccCCceEEEEEeccceeeeeecCccceeEeeeeeeC
Confidence 999999999999999999999999999999999999999999986655 999999999999999999999999999999
Q ss_pred CCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 167 AKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 167 ~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
++.|++++. ||.|++|++ .+.+....+. .|...++.+ +. ++....+++|+.||.|.+|.=.+
T Consensus 559 ~~qliS~~a-dGliKlWni--kt~eC~~tlD---~H~DrvWaL--~~-~~~~~~~~tgg~Dg~i~~wkD~T 620 (775)
T KOG0319|consen 559 GKQLISAGA-DGLIKLWNI--KTNECEMTLD---AHNDRVWAL--SV-SPLLDMFVTGGGDGRIIFWKDVT 620 (775)
T ss_pred CcEEEeccC-CCcEEEEec--cchhhhhhhh---hccceeEEE--ee-cCccceeEecCCCeEEEEeecCc
Confidence 999999998 999999999 6777777777 888888877 55 67777999999999999996544
No 37
>KOG0276 consensus Vesicle coat complex COPI, beta' subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.95 E-value=2.1e-26 Score=196.88 Aligned_cols=244 Identities=15% Similarity=0.115 Sum_probs=197.8
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
.++..|.|+.|+|... .++++-.+|.|.|||.++..++..+.- ..-+|.+..|-+.-+++++|++|..|+
T Consensus 11 ~rSdRVKsVd~HPteP---------w~la~LynG~V~IWnyetqtmVksfeV-~~~PvRa~kfiaRknWiv~GsDD~~Ir 80 (794)
T KOG0276|consen 11 SRSDRVKSVDFHPTEP---------WILAALYNGDVQIWNYETQTMVKSFEV-SEVPVRAAKFIARKNWIVTGSDDMQIR 80 (794)
T ss_pred ccCCceeeeecCCCCc---------eEEEeeecCeeEEEecccceeeeeeee-cccchhhheeeeccceEEEecCCceEE
Confidence 5789999999999998 999999999999999999999988887 777999999999999999999999999
Q ss_pred EEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCC-ceeEEeecCCCCeEEEEECCC-CCEEEEEE
Q 036605 99 EMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENG-EEVLKFSDDVGPLQYVSASDG-AKIIITAG 174 (340)
Q Consensus 99 ~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~-~~~~~~~~~~~~v~~~~~s~~-~~~l~s~~ 174 (340)
+|+..+++.+..|.+|..-|.+++++|...++++++.+ |++||.+.+ .+.+.|.+|...|.+++|.|. .+.+++++
T Consensus 81 Vfnynt~ekV~~FeAH~DyIR~iavHPt~P~vLtsSDDm~iKlW~we~~wa~~qtfeGH~HyVMqv~fnPkD~ntFaS~s 160 (794)
T KOG0276|consen 81 VFNYNTGEKVKTFEAHSDYIRSIAVHPTLPYVLTSSDDMTIKLWDWENEWACEQTFEGHEHYVMQVAFNPKDPNTFASAS 160 (794)
T ss_pred EEecccceeeEEeeccccceeeeeecCCCCeEEecCCccEEEEeeccCceeeeeEEcCcceEEEEEEecCCCccceeeee
Confidence 99999999999999999999999999999999998777 999999876 455889999999999999985 55778877
Q ss_pred cCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCCceEEEeec
Q 036605 175 YGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNPAKITVKLK 254 (340)
Q Consensus 175 ~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p~~i~~~~~ 254 (340)
. |++|+||.+ .+. ...+.+. +|...+..+ +.+..+|..+|++|+.|..|+|||..+...+.++..+.-.++..
T Consensus 161 L-DrTVKVWsl--gs~--~~nfTl~-gHekGVN~V-dyy~~gdkpylIsgaDD~tiKvWDyQtk~CV~TLeGHt~Nvs~v 233 (794)
T KOG0276|consen 161 L-DRTVKVWSL--GSP--HPNFTLE-GHEKGVNCV-DYYTGGDKPYLISGADDLTIKVWDYQTKSCVQTLEGHTNNVSFV 233 (794)
T ss_pred c-cccEEEEEc--CCC--CCceeee-ccccCcceE-EeccCCCcceEEecCCCceEEEeecchHHHHHHhhcccccceEE
Confidence 7 999999999 333 2333333 676666655 33336777899999999999999999988887777633222211
Q ss_pred ccccccccccccccccceeeeeecccccCCCeEEEecCCc
Q 036605 255 KADADQQNSVNVKKSRTSIIAARLNDLEADGQKTITGLHD 294 (340)
Q Consensus 255 ~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~~~~~ 294 (340)
.-.|..+-|+.+. +|+++.++....
T Consensus 234 ----------~fhp~lpiiisgs-----EDGTvriWhs~T 258 (794)
T KOG0276|consen 234 ----------FFHPELPIIISGS-----EDGTVRIWNSKT 258 (794)
T ss_pred ----------EecCCCcEEEEec-----CCccEEEecCcc
Confidence 1244443343333 788888884433
No 38
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=99.95 E-value=1.7e-27 Score=182.41 Aligned_cols=215 Identities=12% Similarity=0.167 Sum_probs=184.8
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe-eEEEecCCCCCCeEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE-MKWKSTGRHPGGLAGL 79 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~-~~~~~~~~h~~~v~~v 79 (340)
|||..+|..+..|. |.--|..++|+.|.. +|++|+.+..++|||++..+ ....+.+ |++.|..+
T Consensus 85 vw~a~tgdelhsf~-----hkhivk~~af~~ds~---------~lltgg~ekllrvfdln~p~App~E~~g-htg~Ir~v 149 (334)
T KOG0278|consen 85 VWDAVTGDELHSFE-----HKHIVKAVAFSQDSN---------YLLTGGQEKLLRVFDLNRPKAPPKEISG-HTGGIRTV 149 (334)
T ss_pred hhhhhhhhhhhhhh-----hhheeeeEEecccch---------hhhccchHHHhhhhhccCCCCCchhhcC-CCCcceeE
Confidence 69999999888775 888999999999998 89999999999999998765 4556677 99999999
Q ss_pred EEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc-EEEEECCCCceeEEeecCCCCe
Q 036605 80 AFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE-VRILSLENGEEVLKFSDDVGPL 158 (340)
Q Consensus 80 ~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~-i~i~d~~~~~~~~~~~~~~~~v 158 (340)
-|....+.+++.+.|+.|++||.+++..++.+.. +.+|+++.++++|+++.++.+. |.+||..+-..+..+.. +..|
T Consensus 150 ~wc~eD~~iLSSadd~tVRLWD~rTgt~v~sL~~-~s~VtSlEvs~dG~ilTia~gssV~Fwdaksf~~lKs~k~-P~nV 227 (334)
T KOG0278|consen 150 LWCHEDKCILSSADDKTVRLWDHRTGTEVQSLEF-NSPVTSLEVSQDGRILTIAYGSSVKFWDAKSFGLLKSYKM-PCNV 227 (334)
T ss_pred EEeccCceEEeeccCCceEEEEeccCcEEEEEec-CCCCcceeeccCCCEEEEecCceeEEeccccccceeeccC-cccc
Confidence 9999899999999999999999999999988864 6689999999999999887666 99999999888877753 5678
Q ss_pred EEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 159 QYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 159 ~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
.+..++|+...+++++. |..++.||. .+++.+... .-+|...+..+ .| +|+|...++||.||+|++|....+
T Consensus 228 ~SASL~P~k~~fVaGge-d~~~~kfDy--~TgeEi~~~--nkgh~gpVhcV--rF-SPdGE~yAsGSEDGTirlWQt~~~ 299 (334)
T KOG0278|consen 228 ESASLHPKKEFFVAGGE-DFKVYKFDY--NTGEEIGSY--NKGHFGPVHCV--RF-SPDGELYASGSEDGTIRLWQTTPG 299 (334)
T ss_pred ccccccCCCceEEecCc-ceEEEEEec--cCCceeeec--ccCCCCceEEE--EE-CCCCceeeccCCCceEEEEEecCC
Confidence 99999999988888777 999999999 677665553 22777777776 66 899999999999999999998664
Q ss_pred Cc
Q 036605 239 SQ 240 (340)
Q Consensus 239 ~~ 240 (340)
+.
T Consensus 300 ~~ 301 (334)
T KOG0278|consen 300 KT 301 (334)
T ss_pred Cc
Confidence 43
No 39
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=99.95 E-value=8.2e-26 Score=190.10 Aligned_cols=211 Identities=16% Similarity=0.259 Sum_probs=178.3
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
|||..+++....+. .|...+.++.|+|+++ ++++++.+|.|.+||+.+++....+.. |...|.+++
T Consensus 77 i~~~~~~~~~~~~~----~~~~~i~~~~~~~~~~---------~~~~~~~~~~i~~~~~~~~~~~~~~~~-~~~~i~~~~ 142 (289)
T cd00200 77 LWDLETGECVRTLT----GHTSYVSSVAFSPDGR---------ILSSSSRDKTIKVWDVETGKCLTTLRG-HTDWVNSVA 142 (289)
T ss_pred EEEcCcccceEEEe----ccCCcEEEEEEcCCCC---------EEEEecCCCeEEEEECCCcEEEEEecc-CCCcEEEEE
Confidence 58888877777776 6778999999999988 888888899999999998888888886 999999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec--CcEEEEECCCCceeEEeecCCCCe
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALAS--SEVRILSLENGEEVLKFSDDVGPL 158 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~--~~i~i~d~~~~~~~~~~~~~~~~v 158 (340)
|+|++.++++++.|+.|.+||+.+++.+..+..+...+.++.|+|++..+++++ +.+++||+..++.+..+..|...+
T Consensus 143 ~~~~~~~l~~~~~~~~i~i~d~~~~~~~~~~~~~~~~i~~~~~~~~~~~l~~~~~~~~i~i~d~~~~~~~~~~~~~~~~i 222 (289)
T cd00200 143 FSPDGTFVASSSQDGTIKLWDLRTGKCVATLTGHTGEVNSVAFSPDGEKLLSSSSDGTIKLWDLSTGKCLGTLRGHENGV 222 (289)
T ss_pred EcCcCCEEEEEcCCCcEEEEEccccccceeEecCccccceEEECCCcCEEEEecCCCcEEEEECCCCceecchhhcCCce
Confidence 999988888888899999999999988888888888999999999998777754 449999999988888888888999
Q ss_pred EEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEE
Q 036605 159 QYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWD 234 (340)
Q Consensus 159 ~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd 234 (340)
.++.|+|++.++++++. ++.|++|+++ .+.....+. .+...+..+ .+ ++++.++++++.||.+++|+
T Consensus 223 ~~~~~~~~~~~~~~~~~-~~~i~i~~~~--~~~~~~~~~---~~~~~i~~~--~~-~~~~~~l~~~~~d~~i~iw~ 289 (289)
T cd00200 223 NSVAFSPDGYLLASGSE-DGTIRVWDLR--TGECVQTLS---GHTNSVTSL--AW-SPDGKRLASGSADGTIRIWD 289 (289)
T ss_pred EEEEEcCCCcEEEEEcC-CCcEEEEEcC--CceeEEEcc---ccCCcEEEE--EE-CCCCCEEEEecCCCeEEecC
Confidence 99999999888887665 9999999983 333333332 444445554 55 78889999999999999996
No 40
>KOG0292 consensus Vesicle coat complex COPI, alpha subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.95 E-value=5.5e-27 Score=207.65 Aligned_cols=223 Identities=13% Similarity=0.162 Sum_probs=190.3
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
+||..-|.++..|. .|+++|..++|+|.+. ++++|+.|-.|++|+..+.+++.++.+ |-+.|..+.
T Consensus 35 lWDYRM~tli~rFd----eHdGpVRgv~FH~~qp---------lFVSGGDDykIkVWnYk~rrclftL~G-HlDYVRt~~ 100 (1202)
T KOG0292|consen 35 LWDYRMGTLIDRFD----EHDGPVRGVDFHPTQP---------LFVSGGDDYKIKVWNYKTRRCLFTLLG-HLDYVRTVF 100 (1202)
T ss_pred eehhhhhhHHhhhh----ccCCccceeeecCCCC---------eEEecCCccEEEEEecccceehhhhcc-ccceeEEee
Confidence 69999999999998 8999999999999999 999999999999999999999999999 999999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec--CcEEEEECCCCc------------
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALAS--SEVRILSLENGE------------ 146 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~--~~i~i~d~~~~~------------ 146 (340)
|++.-.+++++|+|.+|++|+.++++.+..+++|...|.|.+|+|....+++++ .+|++||+...+
T Consensus 101 FHheyPWIlSASDDQTIrIWNwqsr~~iavltGHnHYVMcAqFhptEDlIVSaSLDQTVRVWDisGLRkk~~~pg~~e~~ 180 (1202)
T KOG0292|consen 101 FHHEYPWILSASDDQTIRIWNWQSRKCIAVLTGHNHYVMCAQFHPTEDLIVSASLDQTVRVWDISGLRKKNKAPGSLEDQ 180 (1202)
T ss_pred ccCCCceEEEccCCCeEEEEeccCCceEEEEecCceEEEeeccCCccceEEEecccceEEEEeecchhccCCCCCCchhh
Confidence 999999999999999999999999999999999999999999999988888865 449999985311
Q ss_pred ---------------ee--EEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeee
Q 036605 147 ---------------EV--LKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDC 209 (340)
Q Consensus 147 ---------------~~--~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~ 209 (340)
.+ ..+.+|...|+-++|+|.-..|++++. |+.|++|.+. .++. ......-+|...+..+
T Consensus 181 ~~~~~~~~dLfg~~DaVVK~VLEGHDRGVNwaAfhpTlpliVSG~D-DRqVKlWrmn-etKa--WEvDtcrgH~nnVssv 256 (1202)
T KOG0292|consen 181 MRGQQGNSDLFGQTDAVVKHVLEGHDRGVNWAAFHPTLPLIVSGAD-DRQVKLWRMN-ETKA--WEVDTCRGHYNNVSSV 256 (1202)
T ss_pred hhccccchhhcCCcCeeeeeeecccccccceEEecCCcceEEecCC-cceeeEEEec-cccc--eeehhhhcccCCcceE
Confidence 11 234789999999999999999999888 9999999984 2221 1111122666655555
Q ss_pred ecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCC
Q 036605 210 KNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKT 244 (340)
Q Consensus 210 ~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~ 244 (340)
.| +|....+++.++|+.|+|||+.....+..+
T Consensus 257 --lf-hp~q~lIlSnsEDksirVwDm~kRt~v~tf 288 (1202)
T KOG0292|consen 257 --LF-HPHQDLILSNSEDKSIRVWDMTKRTSVQTF 288 (1202)
T ss_pred --Ee-cCccceeEecCCCccEEEEecccccceeee
Confidence 55 888899999999999999999876555544
No 41
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=99.95 E-value=1e-25 Score=181.23 Aligned_cols=212 Identities=16% Similarity=0.286 Sum_probs=179.2
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
||+..+|....+++ +|+..|+|+.||.+|. |||+|.-+|.|.||...++...+.+.. .-+.|.=+.
T Consensus 90 lW~~~~ge~~~elt----gHKDSVt~~~Fshdgt---------lLATGdmsG~v~v~~~stg~~~~~~~~-e~~dieWl~ 155 (399)
T KOG0296|consen 90 LWDISTGEFAGELT----GHKDSVTCCSFSHDGT---------LLATGDMSGKVLVFKVSTGGEQWKLDQ-EVEDIEWLK 155 (399)
T ss_pred EEEccCCcceeEec----CCCCceEEEEEccCce---------EEEecCCCccEEEEEcccCceEEEeec-ccCceEEEE
Confidence 69999999999998 9999999999999999 999999999999999999999988875 566788899
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEe--cCcEEEEECCCCceeEEee------
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALA--SSEVRILSLENGEEVLKFS------ 152 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~--~~~i~i~d~~~~~~~~~~~------ 152 (340)
|+|.+..|+.|+.||.+.+|.+.++.....+.+|..++++=.|.|+|+.++++ +++|++|++.++.++..+.
T Consensus 156 WHp~a~illAG~~DGsvWmw~ip~~~~~kv~~Gh~~~ct~G~f~pdGKr~~tgy~dgti~~Wn~ktg~p~~~~~~~e~~~ 235 (399)
T KOG0296|consen 156 WHPRAHILLAGSTDGSVWMWQIPSQALCKVMSGHNSPCTCGEFIPDGKRILTGYDDGTIIVWNPKTGQPLHKITQAEGLE 235 (399)
T ss_pred ecccccEEEeecCCCcEEEEECCCcceeeEecCCCCCcccccccCCCceEEEEecCceEEEEecCCCceeEEecccccCc
Confidence 99999999999999999999999988888899999999999999999999885 5559999999887665443
Q ss_pred --------------------------------------------------------------------------------
Q 036605 153 -------------------------------------------------------------------------------- 152 (340)
Q Consensus 153 -------------------------------------------------------------------------------- 152 (340)
T Consensus 236 ~~~~~~~~~~~~~~~g~~e~~~~~~~~~sgKVv~~~n~~~~~l~~~~e~~~esve~~~~ss~lpL~A~G~vdG~i~iyD~ 315 (399)
T KOG0296|consen 236 LPCISLNLAGSTLTKGNSEGVACGVNNGSGKVVNCNNGTVPELKPSQEELDESVESIPSSSKLPLAACGSVDGTIAIYDL 315 (399)
T ss_pred CCccccccccceeEeccCCccEEEEccccceEEEecCCCCccccccchhhhhhhhhcccccccchhhcccccceEEEEec
Confidence
Q ss_pred ---------cCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEE
Q 036605 153 ---------DDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILA 223 (340)
Q Consensus 153 ---------~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~ 223 (340)
.|..+|..+.|.+ ..+|++++. +|.|+.||.| +++....+. +|...+.++ +. +|+..++++
T Consensus 316 a~~~~R~~c~he~~V~~l~w~~-t~~l~t~c~-~g~v~~wDaR--tG~l~~~y~---GH~~~Il~f--~l-s~~~~~vvT 385 (399)
T KOG0296|consen 316 AASTLRHICEHEDGVTKLKWLN-TDYLLTACA-NGKVRQWDAR--TGQLKFTYT---GHQMGILDF--AL-SPQKRLVVT 385 (399)
T ss_pred ccchhheeccCCCceEEEEEcC-cchheeecc-CceEEeeecc--ccceEEEEe---cCchheeEE--EE-cCCCcEEEE
Confidence 1445566666666 567777666 7888888873 555555555 777777776 55 789999999
Q ss_pred EeCCCcEEEEECC
Q 036605 224 VAESGVAYSWDLK 236 (340)
Q Consensus 224 ~s~dg~i~vwd~~ 236 (340)
+|.|+..+||++.
T Consensus 386 ~s~D~~a~VF~v~ 398 (399)
T KOG0296|consen 386 VSDDNTALVFEVP 398 (399)
T ss_pred ecCCCeEEEEecC
Confidence 9999999999864
No 42
>KOG0282 consensus mRNA splicing factor [Function unknown]
Probab=99.95 E-value=1.6e-27 Score=197.97 Aligned_cols=211 Identities=15% Similarity=0.187 Sum_probs=174.7
Q ss_pred CccCC-CCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEE
Q 036605 1 IWSTN-DGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGL 79 (340)
Q Consensus 1 vwd~~-~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v 79 (340)
|||+- .+.++++|. +|..+|..++|+++|. .+.+++.|+.|++||+++|+++.++.. ...++|+
T Consensus 241 lW~vy~~~~~lrtf~----gH~k~Vrd~~~s~~g~---------~fLS~sfD~~lKlwDtETG~~~~~f~~--~~~~~cv 305 (503)
T KOG0282|consen 241 LWNVYDDRRCLRTFK----GHRKPVRDASFNNCGT---------SFLSASFDRFLKLWDTETGQVLSRFHL--DKVPTCV 305 (503)
T ss_pred EEEEecCcceehhhh----cchhhhhhhhccccCC---------eeeeeecceeeeeeccccceEEEEEec--CCCceee
Confidence 57764 488999998 9999999999999998 799999999999999999999988873 4568999
Q ss_pred EEecCC-CEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCcee--------
Q 036605 80 AFAKKG-RSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEV-------- 148 (340)
Q Consensus 80 ~~~~~~-~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~-------- 148 (340)
.|+|++ +.+++|+.|+.|+.||+++++.++.+..|-+.|..+.|-++|+.+++.+.+ ++||+.+.+-.+
T Consensus 306 kf~pd~~n~fl~G~sd~ki~~wDiRs~kvvqeYd~hLg~i~~i~F~~~g~rFissSDdks~riWe~~~~v~ik~i~~~~~ 385 (503)
T KOG0282|consen 306 KFHPDNQNIFLVGGSDKKIRQWDIRSGKVVQEYDRHLGAILDITFVDEGRRFISSSDDKSVRIWENRIPVPIKNIADPEM 385 (503)
T ss_pred ecCCCCCcEEEEecCCCcEEEEeccchHHHHHHHhhhhheeeeEEccCCceEeeeccCccEEEEEcCCCccchhhcchhh
Confidence 999998 789999999999999999999999999999999999999999999886554 999988654221
Q ss_pred --------------------------------------EEeecCC--CCeEEEEECCCCCEEEEEEcCCCeEEEEEccCC
Q 036605 149 --------------------------------------LKFSDDV--GPLQYVSASDGAKIIITAGYGEKHLQVWRCDIS 188 (340)
Q Consensus 149 --------------------------------------~~~~~~~--~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~ 188 (340)
..|.+|. +.-..+.|||||.+|++|.. ||.+.+||+ .
T Consensus 386 hsmP~~~~~P~~~~~~aQs~dN~i~ifs~~~~~r~nkkK~feGh~vaGys~~v~fSpDG~~l~SGds-dG~v~~wdw--k 462 (503)
T KOG0282|consen 386 HTMPCLTLHPNGKWFAAQSMDNYIAIFSTVPPFRLNKKKRFEGHSVAGYSCQVDFSPDGRTLCSGDS-DGKVNFWDW--K 462 (503)
T ss_pred ccCcceecCCCCCeehhhccCceEEEEecccccccCHhhhhcceeccCceeeEEEcCCCCeEEeecC-CccEEEeec--h
Confidence 1122343 44577899999999999777 999999999 4
Q ss_pred CCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEE
Q 036605 189 SKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWD 234 (340)
Q Consensus 189 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd 234 (340)
+.+....+. .|....+.+ .|.......+++++.||.|++|+
T Consensus 463 t~kl~~~lk---ah~~~ci~v--~wHP~e~Skvat~~w~G~Ikiwd 503 (503)
T KOG0282|consen 463 TTKLVSKLK---AHDQPCIGV--DWHPVEPSKVATCGWDGLIKIWD 503 (503)
T ss_pred hhhhhhccc---cCCcceEEE--EecCCCcceeEecccCceeEecC
Confidence 545555555 665666666 66445667899999999999996
No 43
>KOG0645 consensus WD40 repeat protein [General function prediction only]
Probab=99.95 E-value=2.7e-25 Score=172.13 Aligned_cols=195 Identities=14% Similarity=0.145 Sum_probs=164.5
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCC--eeEEEecCCCCCCeEEEEEecCCCEEEEEeCCC
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTG--EMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNG 95 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~--~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg 95 (340)
.+|...|..++|+|.|+ +||+|+.|+++.||.-..+ +++..+.+ |...|.|++|+++|++|++|+.|.
T Consensus 58 ~~hkrsVRsvAwsp~g~---------~La~aSFD~t~~Iw~k~~~efecv~~lEG-HEnEVK~Vaws~sG~~LATCSRDK 127 (312)
T KOG0645|consen 58 DGHKRSVRSVAWSPHGR---------YLASASFDATVVIWKKEDGEFECVATLEG-HENEVKCVAWSASGNYLATCSRDK 127 (312)
T ss_pred ccchheeeeeeecCCCc---------EEEEeeccceEEEeecCCCceeEEeeeec-cccceeEEEEcCCCCEEEEeeCCC
Confidence 47999999999999999 9999999999999986655 46778888 999999999999999999999999
Q ss_pred cEEEEeCCCCe---EEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCC---CceeEEeecCCCCeEEEEECCCC
Q 036605 96 MASEMKSEMGE---VIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLEN---GEEVLKFSDDVGPLQYVSASDGA 167 (340)
Q Consensus 96 ~i~~wd~~~~~---~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~---~~~~~~~~~~~~~v~~~~~s~~~ 167 (340)
.|-+|.+..+. ....+..|...|..+.|+|...+|++++.+ |++|.-.. -...+++.+|...|.+++|++.|
T Consensus 128 SVWiWe~deddEfec~aVL~~HtqDVK~V~WHPt~dlL~S~SYDnTIk~~~~~~dddW~c~~tl~g~~~TVW~~~F~~~G 207 (312)
T KOG0645|consen 128 SVWIWEIDEDDEFECIAVLQEHTQDVKHVIWHPTEDLLFSCSYDNTIKVYRDEDDDDWECVQTLDGHENTVWSLAFDNIG 207 (312)
T ss_pred eEEEEEecCCCcEEEEeeeccccccccEEEEcCCcceeEEeccCCeEEEEeecCCCCeeEEEEecCccceEEEEEecCCC
Confidence 99999987543 455688999999999999999999998776 99998762 34678999999999999999999
Q ss_pred CEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 168 KIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 168 ~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
..+++++. |++++||... ..++..|......+ .| . ...|++++.|+.|++|.-..
T Consensus 208 ~rl~s~sd-D~tv~Iw~~~---------~~~~~~~sr~~Y~v--~W-~--~~~IaS~ggD~~i~lf~~s~ 262 (312)
T KOG0645|consen 208 SRLVSCSD-DGTVSIWRLY---------TDLSGMHSRALYDV--PW-D--NGVIASGGGDDAIRLFKESD 262 (312)
T ss_pred ceEEEecC-CcceEeeeec---------cCcchhcccceEee--ee-c--ccceEeccCCCEEEEEEecC
Confidence 99999877 9999999962 11222444455555 45 2 45799999999999997664
No 44
>KOG0281 consensus Beta-TrCP (transducin repeats containing)/Slimb proteins [Function unknown]
Probab=99.95 E-value=1.6e-27 Score=190.67 Aligned_cols=208 Identities=15% Similarity=0.275 Sum_probs=175.9
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe---eEEEecCCCCCCeE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE---MKWKSTGRHPGGLA 77 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~---~~~~~~~~h~~~v~ 77 (340)
|||.++|+++.++. ||...|.-+.|+ .. ++++++.|.+|.+||+.... +.+.+.+ |...|+
T Consensus 261 vWDv~tge~l~tli----hHceaVLhlrf~--ng---------~mvtcSkDrsiaVWdm~sps~it~rrVLvG-HrAaVN 324 (499)
T KOG0281|consen 261 VWDVNTGEPLNTLI----HHCEAVLHLRFS--NG---------YMVTCSKDRSIAVWDMASPTDITLRRVLVG-HRAAVN 324 (499)
T ss_pred EEeccCCchhhHHh----hhcceeEEEEEe--CC---------EEEEecCCceeEEEeccCchHHHHHHHHhh-hhhhee
Confidence 79999999999998 999999999998 34 79999999999999998765 2234556 999999
Q ss_pred EEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCC
Q 036605 78 GLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDV 155 (340)
Q Consensus 78 ~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~ 155 (340)
.+.|+ .+++++++.|.+|++|++.+++.+.++.+|+..|.|+.+. ++++++|+.+ |++||++.|..++.+.+|+
T Consensus 325 vVdfd--~kyIVsASgDRTikvW~~st~efvRtl~gHkRGIAClQYr--~rlvVSGSSDntIRlwdi~~G~cLRvLeGHE 400 (499)
T KOG0281|consen 325 VVDFD--DKYIVSASGDRTIKVWSTSTCEFVRTLNGHKRGIACLQYR--DRLVVSGSSDNTIRLWDIECGACLRVLEGHE 400 (499)
T ss_pred eeccc--cceEEEecCCceEEEEeccceeeehhhhcccccceehhcc--CeEEEecCCCceEEEEeccccHHHHHHhchH
Confidence 99996 6699999999999999999999999999999999998764 7888887665 9999999999999999999
Q ss_pred CCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCce------eeecCCCeeeeeecCCCCCCCCEEEEEeCCCc
Q 036605 156 GPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPA------LSMRHSPVAIDCKNSPNGEDGTVILAVAESGV 229 (340)
Q Consensus 156 ~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~------~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~ 229 (340)
.-|.++.| |.+.|++|+. ||.|+|||+ .......... ....|...++.+ .-|...+++.+.|.+
T Consensus 401 eLvRciRF--d~krIVSGaY-DGkikvWdl--~aaldpra~~~~~Cl~~lv~hsgRVFrL-----QFD~fqIvsssHddt 470 (499)
T KOG0281|consen 401 ELVRCIRF--DNKRIVSGAY-DGKIKVWDL--QAALDPRAPASTLCLRTLVEHSGRVFRL-----QFDEFQIISSSHDDT 470 (499)
T ss_pred Hhhhheee--cCceeeeccc-cceEEEEec--ccccCCcccccchHHHhhhhccceeEEE-----eecceEEEeccCCCe
Confidence 99999999 4568999998 999999999 3433222111 122567777777 456788999999999
Q ss_pred EEEEECCCC
Q 036605 230 AYSWDLKTV 238 (340)
Q Consensus 230 i~vwd~~~~ 238 (340)
|.|||+.++
T Consensus 471 ILiWdFl~~ 479 (499)
T KOG0281|consen 471 ILIWDFLNG 479 (499)
T ss_pred EEEEEcCCC
Confidence 999999764
No 45
>PLN00181 protein SPA1-RELATED; Provisional
Probab=99.95 E-value=3e-25 Score=211.62 Aligned_cols=213 Identities=14% Similarity=0.151 Sum_probs=172.8
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeec-cccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGF-VGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGL 79 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp-~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v 79 (340)
|||+.+++.+..+. +|...|++++|+| ++. +|++|+.||+|++||+.++..+..+.. + ..|.++
T Consensus 559 lWd~~~~~~~~~~~----~H~~~V~~l~~~p~~~~---------~L~Sgs~Dg~v~iWd~~~~~~~~~~~~-~-~~v~~v 623 (793)
T PLN00181 559 VWDVARSQLVTEMK----EHEKRVWSIDYSSADPT---------LLASGSDDGSVKLWSINQGVSIGTIKT-K-ANICCV 623 (793)
T ss_pred EEECCCCeEEEEec----CCCCCEEEEEEcCCCCC---------EEEEEcCCCEEEEEECCCCcEEEEEec-C-CCeEEE
Confidence 69999998888887 8999999999997 668 899999999999999999988877764 4 689999
Q ss_pred EEe-cCCCEEEEEeCCCcEEEEeCCCCe-EEEEeecCCCCeeEEEEccCCCEEEEec--CcEEEEECCCC------ceeE
Q 036605 80 AFA-KKGRSLHVVGTNGMASEMKSEMGE-VIREFKASEKPISSSAFLCEEKIFALAS--SEVRILSLENG------EEVL 149 (340)
Q Consensus 80 ~~~-~~~~~l~s~~~dg~i~~wd~~~~~-~~~~~~~~~~~i~~l~~~~~~~~l~~~~--~~i~i~d~~~~------~~~~ 149 (340)
.|+ +++..|++|+.||.|++||++++. .+..+.+|...|.++.|. ++.++++++ +.|++||+..+ ..+.
T Consensus 624 ~~~~~~g~~latgs~dg~I~iwD~~~~~~~~~~~~~h~~~V~~v~f~-~~~~lvs~s~D~~ikiWd~~~~~~~~~~~~l~ 702 (793)
T PLN00181 624 QFPSESGRSLAFGSADHKVYYYDLRNPKLPLCTMIGHSKTVSYVRFV-DSSTLVSSSTDNTLKLWDLSMSISGINETPLH 702 (793)
T ss_pred EEeCCCCCEEEEEeCCCeEEEEECCCCCccceEecCCCCCEEEEEEe-CCCEEEEEECCCEEEEEeCCCCccccCCcceE
Confidence 995 478999999999999999998765 466778899999999997 567777754 44999999743 4677
Q ss_pred EeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCcee----------eecCCCeeeeeecCCCCCCCC
Q 036605 150 KFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPAL----------SMRHSPVAIDCKNSPNGEDGT 219 (340)
Q Consensus 150 ~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~----------~~~~~~~~~~~~~~~~~~~~~ 219 (340)
.+.+|...+..+.|++++.+|++++. |+.|.+|+.. .........+ ...+...+..+ +| ++++.
T Consensus 703 ~~~gh~~~i~~v~~s~~~~~lasgs~-D~~v~iw~~~--~~~~~~s~~~~~~~~~~~~~~~~~~~~V~~v--~w-s~~~~ 776 (793)
T PLN00181 703 SFMGHTNVKNFVGLSVSDGYIATGSE-TNEVFVYHKA--FPMPVLSYKFKTIDPVSGLEVDDASQFISSV--CW-RGQSS 776 (793)
T ss_pred EEcCCCCCeeEEEEcCCCCEEEEEeC-CCEEEEEECC--CCCceEEEecccCCcccccccCCCCcEEEEE--EE-cCCCC
Confidence 88999999999999999999999887 9999999973 2211100000 01233345555 67 89999
Q ss_pred EEEEEeCCCcEEEEEC
Q 036605 220 VILAVAESGVAYSWDL 235 (340)
Q Consensus 220 ~l~~~s~dg~i~vwd~ 235 (340)
.|++|+.||.|+||++
T Consensus 777 ~lva~~~dG~I~i~~~ 792 (793)
T PLN00181 777 TLVAANSTGNIKILEM 792 (793)
T ss_pred eEEEecCCCcEEEEec
Confidence 9999999999999986
No 46
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.94 E-value=3.7e-25 Score=193.07 Aligned_cols=223 Identities=16% Similarity=0.169 Sum_probs=181.3
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
|||..+|-+..+|. .|++.|+.+.|+..++ .+++.+-||+|+.||+...+..+++....+-...|++
T Consensus 376 vWn~~SgfC~vTFt----eHts~Vt~v~f~~~g~---------~llssSLDGtVRAwDlkRYrNfRTft~P~p~Qfscva 442 (893)
T KOG0291|consen 376 VWNTQSGFCFVTFT----EHTSGVTAVQFTARGN---------VLLSSSLDGTVRAWDLKRYRNFRTFTSPEPIQFSCVA 442 (893)
T ss_pred EEeccCceEEEEec----cCCCceEEEEEEecCC---------EEEEeecCCeEEeeeecccceeeeecCCCceeeeEEE
Confidence 79999999999999 8999999999999999 8999999999999999999999999864555668999
Q ss_pred EecCCCEEEEEeCC-CcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCC
Q 036605 81 FAKKGRSLHVVGTN-GMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGP 157 (340)
Q Consensus 81 ~~~~~~~l~s~~~d-g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~ 157 (340)
..|.|..+..|+.| -.|.+|++++|+.+-.+.+|+++|.+++|+|++..|++++.+ |++||+-.......-..+...
T Consensus 443 vD~sGelV~AG~~d~F~IfvWS~qTGqllDiLsGHEgPVs~l~f~~~~~~LaS~SWDkTVRiW~if~s~~~vEtl~i~sd 522 (893)
T KOG0291|consen 443 VDPSGELVCAGAQDSFEIFVWSVQTGQLLDILSGHEGPVSGLSFSPDGSLLASGSWDKTVRIWDIFSSSGTVETLEIRSD 522 (893)
T ss_pred EcCCCCEEEeeccceEEEEEEEeecCeeeehhcCCCCcceeeEEccccCeEEeccccceEEEEEeeccCceeeeEeeccc
Confidence 99999999999888 579999999999999999999999999999999999986554 999998554333333346678
Q ss_pred eEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCc--------------eeeecCC---CeeeeeecCCCCCCCCE
Q 036605 158 LQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGP--------------ALSMRHS---PVAIDCKNSPNGEDGTV 220 (340)
Q Consensus 158 v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~--------------~~~~~~~---~~~~~~~~~~~~~~~~~ 220 (340)
+..++|.|+|+-|+++.. ||.|.+||.. ...+...+ .++-.+. ..+..+ ++ ++||.+
T Consensus 523 vl~vsfrPdG~elaVaTl-dgqItf~d~~--~~~q~~~IdgrkD~~~gR~~~D~~ta~~sa~~K~Ftti--~y-SaDG~~ 596 (893)
T KOG0291|consen 523 VLAVSFRPDGKELAVATL-DGQITFFDIK--EAVQVGSIDGRKDLSGGRKETDRITAENSAKGKTFTTI--CY-SADGKC 596 (893)
T ss_pred eeEEEEcCCCCeEEEEEe-cceEEEEEhh--hceeeccccchhhccccccccceeehhhcccCCceEEE--EE-cCCCCE
Confidence 999999999999999888 9999999983 21111000 0000111 112222 34 899999
Q ss_pred EEEEeCCCcEEEEECCCCCccC
Q 036605 221 ILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 221 l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
+++|+....|++|++.++-.+.
T Consensus 597 IlAgG~sn~iCiY~v~~~vllk 618 (893)
T KOG0291|consen 597 ILAGGESNSICIYDVPEGVLLK 618 (893)
T ss_pred EEecCCcccEEEEECchhheee
Confidence 9999999999999998865554
No 47
>KOG0319 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.94 E-value=2.6e-25 Score=193.50 Aligned_cols=210 Identities=18% Similarity=0.213 Sum_probs=176.7
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe----eEEEecCCCCCCeEEEEEecCC-CEEEEEeC
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE----MKWKSTGRHPGGLAGLAFAKKG-RSLHVVGT 93 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~----~~~~~~~~h~~~v~~v~~~~~~-~~l~s~~~ 93 (340)
+|+..|.++....+|- +|++|+.|.++++|.++++. .+....+ |...|.+++++..+ ..|+++|.
T Consensus 363 GH~e~vlSL~~~~~g~---------llat~sKD~svilWr~~~~~~~~~~~a~~~g-H~~svgava~~~~~asffvsvS~ 432 (775)
T KOG0319|consen 363 GHTEAVLSLDVWSSGD---------LLATGSKDKSVILWRLNNNCSKSLCVAQANG-HTNSVGAVAGSKLGASFFVSVSQ 432 (775)
T ss_pred CchhheeeeeecccCc---------EEEEecCCceEEEEEecCCcchhhhhhhhcc-cccccceeeecccCccEEEEecC
Confidence 8999999999655677 89999999999999885443 2333455 99999999997644 47999999
Q ss_pred CCcEEEEeCCCCeEE-----E----EeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEE
Q 036605 94 NGMASEMKSEMGEVI-----R----EFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVS 162 (340)
Q Consensus 94 dg~i~~wd~~~~~~~-----~----~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~ 162 (340)
|+++++|++...+.. . ....|...|++++++|+.+++++++.+ .+||+++.......+.+|...|.++.
T Consensus 433 D~tlK~W~l~~s~~~~~~~~~~~~~t~~aHdKdIN~Vaia~ndkLiAT~SqDktaKiW~le~~~l~~vLsGH~RGvw~V~ 512 (775)
T KOG0319|consen 433 DCTLKLWDLPKSKETAFPIVLTCRYTERAHDKDINCVAIAPNDKLIATGSQDKTAKIWDLEQLRLLGVLSGHTRGVWCVS 512 (775)
T ss_pred CceEEEecCCCcccccccceehhhHHHHhhcccccceEecCCCceEEecccccceeeecccCceEEEEeeCCccceEEEE
Confidence 999999998763211 1 134688999999999999999998776 99999999988999999999999999
Q ss_pred ECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 163 ASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 163 ~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
|++..+.+++++. |.+|+||.+ .+......+. +|...+..+ .| -.++..|++++.||-+++|++++...+.
T Consensus 513 Fs~~dq~laT~Sg-D~TvKIW~i--s~fSClkT~e---GH~~aVlra--~F-~~~~~qliS~~adGliKlWnikt~eC~~ 583 (775)
T KOG0319|consen 513 FSKNDQLLATCSG-DKTVKIWSI--STFSCLKTFE---GHTSAVLRA--SF-IRNGKQLISAGADGLIKLWNIKTNECEM 583 (775)
T ss_pred eccccceeEeccC-CceEEEEEe--ccceeeeeec---CccceeEee--ee-eeCCcEEEeccCCCcEEEEeccchhhhh
Confidence 9999999998777 999999999 6776677777 888888777 77 6788999999999999999999988777
Q ss_pred CCCCc
Q 036605 243 KTNPA 247 (340)
Q Consensus 243 ~~~p~ 247 (340)
++..+
T Consensus 584 tlD~H 588 (775)
T KOG0319|consen 584 TLDAH 588 (775)
T ss_pred hhhhc
Confidence 55553
No 48
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.94 E-value=8.9e-25 Score=166.14 Aligned_cols=239 Identities=15% Similarity=0.183 Sum_probs=191.7
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
.+.++|..+.|.-+|+ |.++++.|.+|++|+...|.+++++.+ |...|..++.+.|+..+++|+.|..|.
T Consensus 15 ~~qgaV~avryN~dGn---------Y~ltcGsdrtvrLWNp~rg~liktYsg-hG~EVlD~~~s~Dnskf~s~GgDk~v~ 84 (307)
T KOG0316|consen 15 CAQGAVRAVRYNVDGN---------YCLTCGSDRTVRLWNPLRGALIKTYSG-HGHEVLDAALSSDNSKFASCGGDKAVQ 84 (307)
T ss_pred ccccceEEEEEccCCC---------EEEEcCCCceEEeecccccceeeeecC-CCceeeeccccccccccccCCCCceEE
Confidence 6789999999999999 999999999999999999999999999 999999999999999999999999999
Q ss_pred EEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCC--ceeEEeecCCCCeEEEEECCCCCEEEEEE
Q 036605 99 EMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENG--EEVLKFSDDVGPLQYVSASDGAKIIITAG 174 (340)
Q Consensus 99 ~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~--~~~~~~~~~~~~v~~~~~s~~~~~l~s~~ 174 (340)
+||+.+|+..++|.+|...|..+.|+.+...+++++-+ +++||.++. ++++.+......|.++.... .-|++++
T Consensus 85 vwDV~TGkv~Rr~rgH~aqVNtV~fNeesSVv~SgsfD~s~r~wDCRS~s~ePiQildea~D~V~Si~v~~--heIvaGS 162 (307)
T KOG0316|consen 85 VWDVNTGKVDRRFRGHLAQVNTVRFNEESSVVASGSFDSSVRLWDCRSRSFEPIQILDEAKDGVSSIDVAE--HEIVAGS 162 (307)
T ss_pred EEEcccCeeeeecccccceeeEEEecCcceEEEeccccceeEEEEcccCCCCccchhhhhcCceeEEEecc--cEEEeec
Confidence 99999999999999999999999999999999987655 999998764 56677766677888888754 4577766
Q ss_pred cCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCC-ceEEEee
Q 036605 175 YGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNP-AKITVKL 253 (340)
Q Consensus 175 ~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p-~~i~~~~ 253 (340)
. ||+++.||+| .+....-.. +++.....+ ++++..+++++.|+.+++.|-.+++.+..++. .......
T Consensus 163 ~-DGtvRtydiR--~G~l~sDy~---g~pit~vs~-----s~d~nc~La~~l~stlrLlDk~tGklL~sYkGhkn~eykl 231 (307)
T KOG0316|consen 163 V-DGTVRTYDIR--KGTLSSDYF---GHPITSVSF-----SKDGNCSLASSLDSTLRLLDKETGKLLKSYKGHKNMEYKL 231 (307)
T ss_pred c-CCcEEEEEee--cceeehhhc---CCcceeEEe-----cCCCCEEEEeeccceeeecccchhHHHHHhcccccceeee
Confidence 6 9999999996 333322222 555444444 89999999999999999999999998886666 2233332
Q ss_pred cccccccccccccccccceeeeeecccccCCCeEEEecCCc
Q 036605 254 KKADADQQNSVNVKKSRTSIIAARLNDLEADGQKTITGLHD 294 (340)
Q Consensus 254 ~~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~~~~~ 294 (340)
+- .-.+....++.. .+||.+.++...+
T Consensus 232 dc---------~l~qsdthV~sg-----SEDG~Vy~wdLvd 258 (307)
T KOG0316|consen 232 DC---------CLNQSDTHVFSG-----SEDGKVYFWDLVD 258 (307)
T ss_pred ee---------eecccceeEEec-----cCCceEEEEEecc
Confidence 21 012223333333 3788888875544
No 49
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.94 E-value=1.4e-25 Score=186.72 Aligned_cols=203 Identities=15% Similarity=0.149 Sum_probs=165.0
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCC-EEEEEeCCCcE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGR-SLHVVGTNGMA 97 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~-~l~s~~~dg~i 97 (340)
.....|.++.|..||+ +||+|...|.|+|||..+...+..+.. |+.+|..+.|+|.++ .|++|++|+.+
T Consensus 66 rFk~~v~s~~fR~DG~---------LlaaGD~sG~V~vfD~k~r~iLR~~~a-h~apv~~~~f~~~d~t~l~s~sDd~v~ 135 (487)
T KOG0310|consen 66 RFKDVVYSVDFRSDGR---------LLAAGDESGHVKVFDMKSRVILRQLYA-HQAPVHVTKFSPQDNTMLVSGSDDKVV 135 (487)
T ss_pred hhccceeEEEeecCCe---------EEEccCCcCcEEEeccccHHHHHHHhh-ccCceeEEEecccCCeEEEecCCCceE
Confidence 4567889999999999 999999999999999776666777777 999999999999655 67778888999
Q ss_pred EEEeCCCCeEEEEeecCCCCeeEEEEccCCC-EEEEecCc--EEEEECCCC-ceeEEeecCCCCeEEEEECCCCCEEEEE
Q 036605 98 SEMKSEMGEVIREFKASEKPISSSAFLCEEK-IFALASSE--VRILSLENG-EEVLKFSDDVGPLQYVSASDGAKIIITA 173 (340)
Q Consensus 98 ~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~-~l~~~~~~--i~i~d~~~~-~~~~~~~~~~~~v~~~~~s~~~~~l~s~ 173 (340)
++||+.++.....+.+|...|.|.+++|... ++++|+.+ |++||++.. ..+.++ .|..+|..+.+-|.|..|+++
T Consensus 136 k~~d~s~a~v~~~l~~htDYVR~g~~~~~~~hivvtGsYDg~vrl~DtR~~~~~v~el-nhg~pVe~vl~lpsgs~iasA 214 (487)
T KOG0310|consen 136 KYWDLSTAYVQAELSGHTDYVRCGDISPANDHIVVTGSYDGKVRLWDTRSLTSRVVEL-NHGCPVESVLALPSGSLIASA 214 (487)
T ss_pred EEEEcCCcEEEEEecCCcceeEeeccccCCCeEEEecCCCceEEEEEeccCCceeEEe-cCCCceeeEEEcCCCCEEEEc
Confidence 9999999998668999999999999999766 55677666 999999987 444555 588999999999999988885
Q ss_pred EcCCCeEEEEEccCCCC-CccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 174 GYGEKHLQVWRCDISSK-TVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 174 ~~~d~~i~iwd~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
+ .+.|+|||+ .++ +...... .|...+.++ .+ ..++..|++|+-||.+++||+.+.+.+.
T Consensus 215 g--Gn~vkVWDl--~~G~qll~~~~---~H~KtVTcL--~l-~s~~~rLlS~sLD~~VKVfd~t~~Kvv~ 274 (487)
T KOG0310|consen 215 G--GNSVKVWDL--TTGGQLLTSMF---NHNKTVTCL--RL-ASDSTRLLSGSLDRHVKVFDTTNYKVVH 274 (487)
T ss_pred C--CCeEEEEEe--cCCceehhhhh---cccceEEEE--Ee-ecCCceEeecccccceEEEEccceEEEE
Confidence 5 489999999 433 3333222 355555555 33 4577999999999999999987766555
No 50
>KOG0305 consensus Anaphase promoting complex, Cdc20, Cdh1, and Ama1 subunits [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=99.94 E-value=1.9e-25 Score=192.23 Aligned_cols=218 Identities=15% Similarity=0.221 Sum_probs=180.3
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
+|+..+|.+..... .+...|+++.|+++|. +||+|..+|.|.|||..+.+.+..+.+.|.+.|-+++
T Consensus 201 lW~~~s~~v~~l~~----~~~~~vtSv~ws~~G~---------~LavG~~~g~v~iwD~~~~k~~~~~~~~h~~rvg~la 267 (484)
T KOG0305|consen 201 LWSASSGSVTELCS----FGEELVTSVKWSPDGS---------HLAVGTSDGTVQIWDVKEQKKTRTLRGSHASRVGSLA 267 (484)
T ss_pred EEecCCCceEEeEe----cCCCceEEEEECCCCC---------EEEEeecCCeEEEEehhhccccccccCCcCceeEEEe
Confidence 58888998776555 3378999999999999 9999999999999999998888888777999999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEE-eecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCC
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIRE-FKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGP 157 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~-~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~ 157 (340)
|. +..+.+|+.|+.|..+|++..+.... +.+|...|+.+.|++|+.++++++.+ +.|||.....++..+..|...
T Consensus 268 W~--~~~lssGsr~~~I~~~dvR~~~~~~~~~~~H~qeVCgLkws~d~~~lASGgnDN~~~Iwd~~~~~p~~~~~~H~aA 345 (484)
T KOG0305|consen 268 WN--SSVLSSGSRDGKILNHDVRISQHVVSTLQGHRQEVCGLKWSPDGNQLASGGNDNVVFIWDGLSPEPKFTFTEHTAA 345 (484)
T ss_pred cc--CceEEEecCCCcEEEEEEecchhhhhhhhcccceeeeeEECCCCCeeccCCCccceEeccCCCccccEEEecccee
Confidence 98 77899999999999999998876655 88899999999999999999998877 999999888888999999999
Q ss_pred eEEEEECCCCCEEEEEEc--CCCeEEEEEccCCCCCccC---------C---------ce--------------------
Q 036605 158 LQYVSASDGAKIIITAGY--GEKHLQVWRCDISSKTVNK---------G---------PA-------------------- 197 (340)
Q Consensus 158 v~~~~~s~~~~~l~s~~~--~d~~i~iwd~~~~~~~~~~---------~---------~~-------------------- 197 (340)
|..++|+|-..-|++.|. .|+.|++||.. ++..+. . +.
T Consensus 346 VKA~awcP~q~~lLAsGGGs~D~~i~fwn~~--~g~~i~~vdtgsQVcsL~Wsk~~kEi~sthG~s~n~i~lw~~ps~~~ 423 (484)
T KOG0305|consen 346 VKALAWCPWQSGLLATGGGSADRCIKFWNTN--TGARIDSVDTGSQVCSLIWSKKYKELLSTHGYSENQITLWKYPSMKL 423 (484)
T ss_pred eeEeeeCCCccCceEEcCCCcccEEEEEEcC--CCcEecccccCCceeeEEEcCCCCEEEEecCCCCCcEEEEeccccce
Confidence 999999997655554433 39999999983 332111 0 00
Q ss_pred --eeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 198 --LSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 198 --~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
.-.+|...+..+ .+ +|||..+++|+.|.++++|++-..
T Consensus 424 ~~~l~gH~~RVl~l--a~-SPdg~~i~t~a~DETlrfw~~f~~ 463 (484)
T KOG0305|consen 424 VAELLGHTSRVLYL--AL-SPDGETIVTGAADETLRFWNLFDE 463 (484)
T ss_pred eeeecCCcceeEEE--EE-CCCCCEEEEecccCcEEeccccCC
Confidence 011344444444 55 899999999999999999998764
No 51
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=99.94 E-value=3.4e-25 Score=181.96 Aligned_cols=214 Identities=18% Similarity=0.183 Sum_probs=177.4
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
++|..+++++..|+ +|...|+.+.|+|+.. .+++++.|..|+||............. |.++|+.+.
T Consensus 245 ~~d~~s~q~l~~~~----Gh~kki~~v~~~~~~~---------~v~~aSad~~i~vws~~~~s~~~~~~~-h~~~V~~ls 310 (506)
T KOG0289|consen 245 LFDKPSNQILATLK----GHTKKITSVKFHKDLD---------TVITASADEIIRVWSVPLSSEPTSSRP-HEEPVTGLS 310 (506)
T ss_pred EEecchhhhhhhcc----CcceEEEEEEeccchh---------heeecCCcceEEeeccccccCcccccc-ccccceeee
Confidence 46777888888888 8999999999999998 899999999999999887776655665 999999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecC--CCCeeEEEEccCCCEEEEec--CcEEEEECCCCceeEEeecCCC
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKAS--EKPISSSAFLCEEKIFALAS--SEVRILSLENGEEVLKFSDDVG 156 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~--~~~i~~l~~~~~~~~l~~~~--~~i~i~d~~~~~~~~~~~~~~~ 156 (340)
.+|.|.+|++++.|+...+.|++++..+...... .-.+++.+|+|||.+++++. +.+++||+.++..+..|.+|.+
T Consensus 311 ~h~tgeYllsAs~d~~w~Fsd~~~g~~lt~vs~~~s~v~~ts~~fHpDgLifgtgt~d~~vkiwdlks~~~~a~Fpght~ 390 (506)
T KOG0289|consen 311 LHPTGEYLLSASNDGTWAFSDISSGSQLTVVSDETSDVEYTSAAFHPDGLIFGTGTPDGVVKIWDLKSQTNVAKFPGHTG 390 (506)
T ss_pred eccCCcEEEEecCCceEEEEEccCCcEEEEEeeccccceeEEeeEcCCceEEeccCCCceEEEEEcCCccccccCCCCCC
Confidence 9999999999999999999999999988776542 34589999999999998854 4499999999999999999999
Q ss_pred CeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECC
Q 036605 157 PLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 157 ~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
+|..++|+.+|.|+++++. |+.|++||+|. .+....+.+ .....+.++ +| ...|.+|+.++.|=+|++++-.
T Consensus 391 ~vk~i~FsENGY~Lat~ad-d~~V~lwDLRK--l~n~kt~~l--~~~~~v~s~--~f-D~SGt~L~~~g~~l~Vy~~~k~ 462 (506)
T KOG0289|consen 391 PVKAISFSENGYWLATAAD-DGSVKLWDLRK--LKNFKTIQL--DEKKEVNSL--SF-DQSGTYLGIAGSDLQVYICKKK 462 (506)
T ss_pred ceeEEEeccCceEEEEEec-CCeEEEEEehh--hcccceeec--cccccceeE--EE-cCCCCeEEeecceeEEEEEecc
Confidence 9999999999999999888 99999999962 222333332 222223333 44 7889999999888777777643
No 52
>KOG0283 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.94 E-value=5.1e-25 Score=194.66 Aligned_cols=244 Identities=14% Similarity=0.138 Sum_probs=178.6
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC--------------------------------C---
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT--------------------------------G--- 62 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~--------------------------------~--- 62 (340)
..|.+.|.|+.||+||+ |||+|+.||.|+||.+.. .
T Consensus 264 ~ah~gaIw~mKFS~DGK---------yLAsaGeD~virVWkVie~e~~~~~~~~~~~~~~~~~~~s~~~p~~s~~~~~~~ 334 (712)
T KOG0283|consen 264 NAHKGAIWAMKFSHDGK---------YLASAGEDGVIRVWKVIESERMRVAEGDSSCMYFEYNANSQIEPSTSSEEKISS 334 (712)
T ss_pred cccCCcEEEEEeCCCCc---------eeeecCCCceEEEEEEeccchhcccccccchhhhhhhhccccCccccccccccc
Confidence 37999999999999999 999999999999998765 0
Q ss_pred -------------------------eeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCC
Q 036605 63 -------------------------EMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKP 117 (340)
Q Consensus 63 -------------------------~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~ 117 (340)
+.++.+.+ |.+.|.++.|+. .++|++++.|.+|++|++...+.+..|. |..-
T Consensus 335 ~~s~~~~~~~s~~~~~p~~~f~f~ekP~~ef~G-Ht~DILDlSWSK-n~fLLSSSMDKTVRLWh~~~~~CL~~F~-Hndf 411 (712)
T KOG0283|consen 335 RTSSSRKGSQSPCVLLPLKAFVFSEKPFCEFKG-HTADILDLSWSK-NNFLLSSSMDKTVRLWHPGRKECLKVFS-HNDF 411 (712)
T ss_pred cccccccccCCccccCCCccccccccchhhhhc-cchhheeccccc-CCeeEeccccccEEeecCCCcceeeEEe-cCCe
Confidence 01122245 999999999995 5699999999999999999999988885 8999
Q ss_pred eeEEEEcc-CCCEEEEec--CcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccC
Q 036605 118 ISSSAFLC-EEKIFALAS--SEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNK 194 (340)
Q Consensus 118 i~~l~~~~-~~~~l~~~~--~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~ 194 (340)
|+|++|+| |.+++++|+ +.++||++...+.+.- .....-|++++|.|||++.+.|.. +|.+++|+.. ..+...
T Consensus 412 VTcVaFnPvDDryFiSGSLD~KvRiWsI~d~~Vv~W-~Dl~~lITAvcy~PdGk~avIGt~-~G~C~fY~t~--~lk~~~ 487 (712)
T KOG0283|consen 412 VTCVAFNPVDDRYFISGSLDGKVRLWSISDKKVVDW-NDLRDLITAVCYSPDGKGAVIGTF-NGYCRFYDTE--GLKLVS 487 (712)
T ss_pred eEEEEecccCCCcEeecccccceEEeecCcCeeEee-hhhhhhheeEEeccCCceEEEEEe-ccEEEEEEcc--CCeEEE
Confidence 99999999 678888865 4599999988765543 334478999999999999999888 9999999973 222211
Q ss_pred Cceeee------cCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCC-ceEEEeecccccccccccccc
Q 036605 195 GPALSM------RHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNP-AKITVKLKKADADQQNSVNVK 267 (340)
Q Consensus 195 ~~~~~~------~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p-~~i~~~~~~~~~~~~~~~~~~ 267 (340)
...+.. .+. .+..+.+.. .+...|++.+.|.+|+|||+.....+..++. ....-+... .-.
T Consensus 488 ~~~I~~~~~Kk~~~~-rITG~Q~~p--~~~~~vLVTSnDSrIRI~d~~~~~lv~KfKG~~n~~SQ~~A---------sfs 555 (712)
T KOG0283|consen 488 DFHIRLHNKKKKQGK-RITGLQFFP--GDPDEVLVTSNDSRIRIYDGRDKDLVHKFKGFRNTSSQISA---------SFS 555 (712)
T ss_pred eeeEeeccCccccCc-eeeeeEecC--CCCCeEEEecCCCceEEEeccchhhhhhhcccccCCcceee---------eEc
Confidence 111111 122 455553343 3333788889999999999988777766664 111111000 012
Q ss_pred cccceeeeeecccccCCCeEEEecCCc
Q 036605 268 KSRTSIIAARLNDLEADGQKTITGLHD 294 (340)
Q Consensus 268 ~~~~~i~~~~~~~~~~~~~~~~~~~~~ 294 (340)
....+|+.+. +|.++-++..+.
T Consensus 556 ~Dgk~IVs~s-----eDs~VYiW~~~~ 577 (712)
T KOG0283|consen 556 SDGKHIVSAS-----EDSWVYIWKNDS 577 (712)
T ss_pred cCCCEEEEee-----cCceEEEEeCCC
Confidence 2345676666 788888886544
No 53
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=99.94 E-value=2.1e-24 Score=173.66 Aligned_cols=210 Identities=16% Similarity=0.119 Sum_probs=177.7
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
.|+.+|.+++.+|+.+ ++++|+.|....+|++.+|.....+.+ |+..|+++.|+.+|.+|++|+.+|.|.
T Consensus 62 ~H~~svFavsl~P~~~---------l~aTGGgDD~AflW~~~~ge~~~eltg-HKDSVt~~~FshdgtlLATGdmsG~v~ 131 (399)
T KOG0296|consen 62 KHTDSVFAVSLHPNNN---------LVATGGGDDLAFLWDISTGEFAGELTG-HKDSVTCCSFSHDGTLLATGDMSGKVL 131 (399)
T ss_pred hcCCceEEEEeCCCCc---------eEEecCCCceEEEEEccCCcceeEecC-CCCceEEEEEccCceEEEecCCCccEE
Confidence 7999999999999888 999999999999999999999999998 999999999999999999999999999
Q ss_pred EEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcC
Q 036605 99 EMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYG 176 (340)
Q Consensus 99 ~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~ 176 (340)
+|...++.....+...-..+.=+.|+|-+.+|+.++.+ +.+|.+.++...+.+.+|..++++=.|.|+|+.++++..
T Consensus 132 v~~~stg~~~~~~~~e~~dieWl~WHp~a~illAG~~DGsvWmw~ip~~~~~kv~~Gh~~~ct~G~f~pdGKr~~tgy~- 210 (399)
T KOG0296|consen 132 VFKVSTGGEQWKLDQEVEDIEWLKWHPRAHILLAGSTDGSVWMWQIPSQALCKVMSGHNSPCTCGEFIPDGKRILTGYD- 210 (399)
T ss_pred EEEcccCceEEEeecccCceEEEEecccccEEEeecCCCcEEEEECCCcceeeEecCCCCCcccccccCCCceEEEEec-
Confidence 99999999888887666678889999999999886555 999999998788889999999999999999999999777
Q ss_pred CCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCC
Q 036605 177 EKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 177 d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p 246 (340)
|++|++|++ .+++......-..+.+...+.. ...+..++.|+.++.+++-+..+++.+...++
T Consensus 211 dgti~~Wn~--ktg~p~~~~~~~e~~~~~~~~~-----~~~~~~~~~g~~e~~~~~~~~~sgKVv~~~n~ 273 (399)
T KOG0296|consen 211 DGTIIVWNP--KTGQPLHKITQAEGLELPCISL-----NLAGSTLTKGNSEGVACGVNNGSGKVVNCNNG 273 (399)
T ss_pred CceEEEEec--CCCceeEEecccccCcCCcccc-----ccccceeEeccCCccEEEEccccceEEEecCC
Confidence 999999998 5654433332111111111112 67788899999999999998888877765554
No 54
>KOG0274 consensus Cdc4 and related F-box and WD-40 proteins [General function prediction only]
Probab=99.94 E-value=6.5e-25 Score=195.45 Aligned_cols=216 Identities=15% Similarity=0.212 Sum_probs=183.9
Q ss_pred CccCCCCceeee-eeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEE
Q 036605 1 IWSTNDGSLLAE-WKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGL 79 (340)
Q Consensus 1 vwd~~~g~~~~~-~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v 79 (340)
+||..++..+.. +. +|.+.|.++++..-+. +|++|+.|.++++||..+|++.+.+.+ |.+.|.++
T Consensus 232 ~~~~~~~~~i~~~l~----GH~g~V~~l~~~~~~~---------~lvsgS~D~t~rvWd~~sg~C~~~l~g-h~stv~~~ 297 (537)
T KOG0274|consen 232 LWDLNNGYLILTRLV----GHFGGVWGLAFPSGGD---------KLVSGSTDKTERVWDCSTGECTHSLQG-HTSSVRCL 297 (537)
T ss_pred EeecccceEEEeecc----CCCCCceeEEEecCCC---------EEEEEecCCcEEeEecCCCcEEEEecC-CCceEEEE
Confidence 588888887766 76 9999999999987556 799999999999999999999999998 99999999
Q ss_pred EEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec--CcEEEEECCCCceeEEeecCCCC
Q 036605 80 AFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALAS--SEVRILSLENGEEVLKFSDDVGP 157 (340)
Q Consensus 80 ~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~--~~i~i~d~~~~~~~~~~~~~~~~ 157 (340)
... ...+++|+.|.+|++|++.++..+..+.+|..+|.++..+ +.++++++ +.|++||+.+++.+..+.+|...
T Consensus 298 ~~~--~~~~~sgs~D~tVkVW~v~n~~~l~l~~~h~~~V~~v~~~--~~~lvsgs~d~~v~VW~~~~~~cl~sl~gH~~~ 373 (537)
T KOG0274|consen 298 TID--PFLLVSGSRDNTVKVWDVTNGACLNLLRGHTGPVNCVQLD--EPLLVSGSYDGTVKVWDPRTGKCLKSLSGHTGR 373 (537)
T ss_pred Ecc--CceEeeccCCceEEEEeccCcceEEEeccccccEEEEEec--CCEEEEEecCceEEEEEhhhceeeeeecCCcce
Confidence 875 5678888999999999999999999999999999999988 66776654 45999999999999999999999
Q ss_pred eEEEEECCCCCEEEEEEcCCCeEEEEEccCCCC-CccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECC
Q 036605 158 LQYVSASDGAKIIITAGYGEKHLQVWRCDISSK-TVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 158 v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
|.++.+.+. .++++++. |++|++||+ .++ +....+. .|...+..+ ...+.+|++++.||.|++||..
T Consensus 374 V~sl~~~~~-~~~~Sgs~-D~~IkvWdl--~~~~~c~~tl~---~h~~~v~~l-----~~~~~~Lvs~~aD~~Ik~WD~~ 441 (537)
T KOG0274|consen 374 VYSLIVDSE-NRLLSGSL-DTTIKVWDL--RTKRKCIHTLQ---GHTSLVSSL-----LLRDNFLVSSSADGTIKLWDAE 441 (537)
T ss_pred EEEEEecCc-ceEEeeee-ccceEeecC--Cchhhhhhhhc---CCccccccc-----ccccceeEeccccccEEEeecc
Confidence 999988775 78999888 999999999 444 4444444 555555444 4567899999999999999999
Q ss_pred CCCccCCCCC
Q 036605 237 TVSQDEKTNP 246 (340)
Q Consensus 237 ~~~~~~~~~p 246 (340)
.++.+..+..
T Consensus 442 ~~~~~~~~~~ 451 (537)
T KOG0274|consen 442 EGECLRTLEG 451 (537)
T ss_pred cCceeeeecc
Confidence 9887774444
No 55
>KOG1446 consensus Histone H3 (Lys4) methyltransferase complex and RNA cleavage factor II complex, subunit SWD2 [RNA processing and modification; Chromatin structure and dynamics; Posttranslational modification, protein turnover, chaperones]
Probab=99.94 E-value=5.9e-24 Score=168.34 Aligned_cols=224 Identities=13% Similarity=0.130 Sum_probs=175.7
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcC--CCcEEEEEccCCeeEEEecCCCCCCeEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTS--NGDILAVDVLTGEMKWKSTGRHPGGLAG 78 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~--dg~i~i~d~~~~~~~~~~~~~h~~~v~~ 78 (340)
|||..+|..+..+. .+...|..++|..... .++.++. |.+|+..++.+.+.++-+.+ |...|+.
T Consensus 40 LYd~~~g~~~~ti~----skkyG~~~~~Fth~~~---------~~i~sStk~d~tIryLsl~dNkylRYF~G-H~~~V~s 105 (311)
T KOG1446|consen 40 LYDSLSGKQVKTIN----SKKYGVDLACFTHHSN---------TVIHSSTKEDDTIRYLSLHDNKYLRYFPG-HKKRVNS 105 (311)
T ss_pred EEEcCCCceeeEee----cccccccEEEEecCCc---------eEEEccCCCCCceEEEEeecCceEEEcCC-CCceEEE
Confidence 57888888888777 6778888999976665 4666665 88999999999999999998 9999999
Q ss_pred EEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCC--ceeEEee--
Q 036605 79 LAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENG--EEVLKFS-- 152 (340)
Q Consensus 79 v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~--~~~~~~~-- 152 (340)
++.+|-+..+++++.|++|++||++..+....+..... ..++|.|+|-++|++.+. |++||+++- .+...|.
T Consensus 106 L~~sP~~d~FlS~S~D~tvrLWDlR~~~cqg~l~~~~~--pi~AfDp~GLifA~~~~~~~IkLyD~Rs~dkgPF~tf~i~ 183 (311)
T KOG1446|consen 106 LSVSPKDDTFLSSSLDKTVRLWDLRVKKCQGLLNLSGR--PIAAFDPEGLIFALANGSELIKLYDLRSFDKGPFTTFSIT 183 (311)
T ss_pred EEecCCCCeEEecccCCeEEeeEecCCCCceEEecCCC--cceeECCCCcEEEEecCCCeEEEEEecccCCCCceeEccC
Confidence 99999999999999999999999997776666654433 457899999999886655 999999864 3445553
Q ss_pred -cCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEE
Q 036605 153 -DDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAY 231 (340)
Q Consensus 153 -~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~ 231 (340)
+.....+.+.|+|||++++.+.. .+.+.+.|. -.+.....+..... .....+.+++ .||+.++++|+.||+|+
T Consensus 184 ~~~~~ew~~l~FS~dGK~iLlsT~-~s~~~~lDA--f~G~~~~tfs~~~~--~~~~~~~a~f-tPds~Fvl~gs~dg~i~ 257 (311)
T KOG1446|consen 184 DNDEAEWTDLEFSPDGKSILLSTN-ASFIYLLDA--FDGTVKSTFSGYPN--AGNLPLSATF-TPDSKFVLSGSDDGTIH 257 (311)
T ss_pred CCCccceeeeEEcCCCCEEEEEeC-CCcEEEEEc--cCCcEeeeEeeccC--CCCcceeEEE-CCCCcEEEEecCCCcEE
Confidence 33567899999999999999777 899999997 56665444442111 1212233366 89999999999999999
Q ss_pred EEECCCCCccCCCCC
Q 036605 232 SWDLKTVSQDEKTNP 246 (340)
Q Consensus 232 vwd~~~~~~~~~~~p 246 (340)
+|+++++.....+++
T Consensus 258 vw~~~tg~~v~~~~~ 272 (311)
T KOG1446|consen 258 VWNLETGKKVAVLRG 272 (311)
T ss_pred EEEcCCCcEeeEecC
Confidence 999999877764444
No 56
>KOG0643 consensus Translation initiation factor 3, subunit i (eIF-3i)/TGF-beta receptor-interacting protein (TRIP-1) [Translation, ribosomal structure and biogenesis; Signal transduction mechanisms]
Probab=99.93 E-value=5.5e-24 Score=164.65 Aligned_cols=204 Identities=15% Similarity=0.152 Sum_probs=176.4
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
+|+.+++.+.+..+|. +|++++.|.++.+|-..+|+.+.++.+ |.+.|+|+..+.+.+.|++|+.|.+++
T Consensus 8 GHERplTqiKyN~eGD---------LlFscaKD~~~~vw~s~nGerlGty~G-HtGavW~~Did~~s~~liTGSAD~t~k 77 (327)
T KOG0643|consen 8 GHERPLTQIKYNREGD---------LLFSCAKDSTPTVWYSLNGERLGTYDG-HTGAVWCCDIDWDSKHLITGSADQTAK 77 (327)
T ss_pred cCccccceEEecCCCc---------EEEEecCCCCceEEEecCCceeeeecC-CCceEEEEEecCCcceeeeccccceeE
Confidence 8999999999999999 999999999999999889999999999 999999999999999999999999999
Q ss_pred EEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE-ecCc------EEEEECC-------CCceeEEeecCCCCeEEEEEC
Q 036605 99 EMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL-ASSE------VRILSLE-------NGEEVLKFSDDVGPLQYVSAS 164 (340)
Q Consensus 99 ~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~-~~~~------i~i~d~~-------~~~~~~~~~~~~~~v~~~~~s 164 (340)
+||+.+|+.+..++. ..+|..+.|+++|.+++. .+.. |.++|++ ..++..++..+...++.+.|.
T Consensus 78 LWDv~tGk~la~~k~-~~~Vk~~~F~~~gn~~l~~tD~~mg~~~~v~~fdi~~~~~~~~s~ep~~kI~t~~skit~a~Wg 156 (327)
T KOG0643|consen 78 LWDVETGKQLATWKT-NSPVKRVDFSFGGNLILASTDKQMGYTCFVSVFDIRDDSSDIDSEEPYLKIPTPDSKITSALWG 156 (327)
T ss_pred EEEcCCCcEEEEeec-CCeeEEEeeccCCcEEEEEehhhcCcceEEEEEEccCChhhhcccCceEEecCCccceeeeeec
Confidence 999999999999874 568999999999988765 3322 9999998 455678888888999999999
Q ss_pred CCCCEEEEEEcCCCeEEEEEccCCCC-CccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 165 DGAKIIITAGYGEKHLQVWRCDISSK-TVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 165 ~~~~~l~s~~~~d~~i~iwd~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
|-+.+|+++.. ||.|.+||++ ++ +...... .|...+.++ .+ +++..++++++.|.+.++||..+.+.+.
T Consensus 157 ~l~~~ii~Ghe-~G~is~~da~--~g~~~v~s~~---~h~~~Ind~--q~-s~d~T~FiT~s~Dttakl~D~~tl~v~K 226 (327)
T KOG0643|consen 157 PLGETIIAGHE-DGSISIYDAR--TGKELVDSDE---EHSSKINDL--QF-SRDRTYFITGSKDTTAKLVDVRTLEVLK 226 (327)
T ss_pred ccCCEEEEecC-CCcEEEEEcc--cCceeeechh---hhccccccc--cc-cCCcceEEecccCccceeeeccceeeEE
Confidence 99999999888 9999999994 43 2222222 455566666 66 8999999999999999999998865554
No 57
>KOG0306 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.93 E-value=3.5e-24 Score=186.93 Aligned_cols=223 Identities=13% Similarity=0.215 Sum_probs=189.6
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
|||..++++++++. ..-+.|..|-|.++ ++++|..+|.+.+||+.....+.++.. |.+.|..++
T Consensus 398 iWn~~t~kciRTi~------~~y~l~~~Fvpgd~---------~Iv~G~k~Gel~vfdlaS~~l~Eti~A-HdgaIWsi~ 461 (888)
T KOG0306|consen 398 IWNRDTLKCIRTIT------CGYILASKFVPGDR---------YIVLGTKNGELQVFDLASASLVETIRA-HDGAIWSIS 461 (888)
T ss_pred EEEccCcceeEEec------cccEEEEEecCCCc---------eEEEeccCCceEEEEeehhhhhhhhhc-cccceeeee
Confidence 69999999999887 23788999999999 999999999999999999988877786 999999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCC-----CeEEEEee-------cCCCCeeEEEEccCCCEEEE--ecCcEEEEECCCCc
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEM-----GEVIREFK-------ASEKPISSSAFLCEEKIFAL--ASSEVRILSLENGE 146 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~-----~~~~~~~~-------~~~~~i~~l~~~~~~~~l~~--~~~~i~i~d~~~~~ 146 (340)
.+||+..+++||.|.+|++||..- |.....+. .-...|.|+.+||||++|++ -+.++++|-+.+.+
T Consensus 462 ~~pD~~g~vT~saDktVkfWdf~l~~~~~gt~~k~lsl~~~rtLel~ddvL~v~~Spdgk~LaVsLLdnTVkVyflDtlK 541 (888)
T KOG0306|consen 462 LSPDNKGFVTGSADKTVKFWDFKLVVSVPGTQKKVLSLKHTRTLELEDDVLCVSVSPDGKLLAVSLLDNTVKVYFLDTLK 541 (888)
T ss_pred ecCCCCceEEecCCcEEEEEeEEEEeccCcccceeeeeccceEEeccccEEEEEEcCCCcEEEEEeccCeEEEEEeccee
Confidence 999999999999999999999631 11111111 13457899999999999988 57779999999998
Q ss_pred eeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeC
Q 036605 147 EVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAE 226 (340)
Q Consensus 147 ~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~ 226 (340)
-...+-+|.-||.+|.++||++.+++++. |..|+||-+ .-+...+.+. .|...+..+ -| -|....+++++.
T Consensus 542 FflsLYGHkLPV~smDIS~DSklivTgSA-DKnVKiWGL--dFGDCHKS~f---AHdDSvm~V--~F-~P~~~~FFt~gK 612 (888)
T KOG0306|consen 542 FFLSLYGHKLPVLSMDISPDSKLIVTGSA-DKNVKIWGL--DFGDCHKSFF---AHDDSVMSV--QF-LPKTHLFFTCGK 612 (888)
T ss_pred eeeeecccccceeEEeccCCcCeEEeccC-CCceEEecc--ccchhhhhhh---cccCceeEE--EE-cccceeEEEecC
Confidence 88899999999999999999999999888 999999998 5677766666 888888777 66 578888999999
Q ss_pred CCcEEEEECCCCCccCCCCCce
Q 036605 227 SGVAYSWDLKTVSQDEKTNPAK 248 (340)
Q Consensus 227 dg~i~vwd~~~~~~~~~~~p~~ 248 (340)
||.|+.||...-+.+..+..+.
T Consensus 613 D~kvKqWDg~kFe~iq~L~~H~ 634 (888)
T KOG0306|consen 613 DGKVKQWDGEKFEEIQKLDGHH 634 (888)
T ss_pred cceEEeechhhhhhheeeccch
Confidence 9999999998877777555544
No 58
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.93 E-value=1.1e-24 Score=181.44 Aligned_cols=209 Identities=11% Similarity=0.130 Sum_probs=168.4
Q ss_pred ccCCCCceeeeeeCCCCCCCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 2 WSTNDGSLLAEWKQPDGEPVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 2 wd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
||..+...+..+. .|..+|..+.|+|.+ . +|++|+.|+.+++||+.+......+.+ |++.|.|.+
T Consensus 95 fD~k~r~iLR~~~----ah~apv~~~~f~~~d~t---------~l~s~sDd~v~k~~d~s~a~v~~~l~~-htDYVR~g~ 160 (487)
T KOG0310|consen 95 FDMKSRVILRQLY----AHQAPVHVTKFSPQDNT---------MLVSGSDDKVVKYWDLSTAYVQAELSG-HTDYVRCGD 160 (487)
T ss_pred eccccHHHHHHHh----hccCceeEEEecccCCe---------EEEecCCCceEEEEEcCCcEEEEEecC-CcceeEeec
Confidence 4433333444555 799999999999988 5 899999999999999999987667888 999999999
Q ss_pred EecC-CCEEEEEeCCCcEEEEeCCCC-eEEEEeecCCCCeeEEEEccCCCEEEEecCc-EEEEECCCC-ceeEEeecCCC
Q 036605 81 FAKK-GRSLHVVGTNGMASEMKSEMG-EVIREFKASEKPISSSAFLCEEKIFALASSE-VRILSLENG-EEVLKFSDDVG 156 (340)
Q Consensus 81 ~~~~-~~~l~s~~~dg~i~~wd~~~~-~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~-i~i~d~~~~-~~~~~~~~~~~ 156 (340)
|+|- +..+++||.||.|++||.++. ..+.++. |..+|..+.+-|.|..+++++|. +++||+.+| +.+..+..|..
T Consensus 161 ~~~~~~hivvtGsYDg~vrl~DtR~~~~~v~eln-hg~pVe~vl~lpsgs~iasAgGn~vkVWDl~~G~qll~~~~~H~K 239 (487)
T KOG0310|consen 161 ISPANDHIVVTGSYDGKVRLWDTRSLTSRVVELN-HGCPVESVLALPSGSLIASAGGNSVKVWDLTTGGQLLTSMFNHNK 239 (487)
T ss_pred cccCCCeEEEecCCCceEEEEEeccCCceeEEec-CCCceeeEEEcCCCCEEEEcCCCeEEEEEecCCceehhhhhcccc
Confidence 9995 448999999999999999987 5555554 78899999999999999997776 999999855 44455666999
Q ss_pred CeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEEC
Q 036605 157 PLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDL 235 (340)
Q Consensus 157 ~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~ 235 (340)
.|+|+++..++..|++++- |+.+++||+ ..-+ ....+..+..+.++ .. +|++..++.|-.+|-+.+=+.
T Consensus 240 tVTcL~l~s~~~rLlS~sL-D~~VKVfd~--t~~K----vv~s~~~~~pvLsi--av-s~dd~t~viGmsnGlv~~rr~ 308 (487)
T KOG0310|consen 240 TVTCLRLASDSTRLLSGSL-DRHVKVFDT--TNYK----VVHSWKYPGPVLSI--AV-SPDDQTVVIGMSNGLVSIRRR 308 (487)
T ss_pred eEEEEEeecCCceEeeccc-ccceEEEEc--cceE----EEEeeecccceeeE--Ee-cCCCceEEEecccceeeeehh
Confidence 9999999999999999998 999999997 3322 23333455555554 44 789999999999997766643
No 59
>KOG0640 consensus mRNA cleavage stimulating factor complex; subunit 1 [RNA processing and modification]
Probab=99.93 E-value=4.8e-25 Score=173.99 Aligned_cols=207 Identities=16% Similarity=0.252 Sum_probs=165.2
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC------------C------eeEEEecCCCCCCeEEEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT------------G------EMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~------------~------~~~~~~~~~h~~~v~~v~ 80 (340)
.|..+|.|.+|+|||. ++|+|+.|..|+|+|++. | -.++++.. |...|+++.
T Consensus 110 ~HK~~cR~aafs~DG~---------lvATGsaD~SIKildvermlaks~~~em~~~~~qa~hPvIRTlYD-H~devn~l~ 179 (430)
T KOG0640|consen 110 SHKSPCRAAAFSPDGS---------LVATGSADASIKILDVERMLAKSKPKEMISGDTQARHPVIRTLYD-HVDEVNDLD 179 (430)
T ss_pred ecccceeeeeeCCCCc---------EEEccCCcceEEEeehhhhhhhcchhhhccCCcccCCceEeehhh-ccCccccee
Confidence 6899999999999999 999999999999999871 1 14566677 999999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEee--cCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEe---ec
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFK--ASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKF---SD 153 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~--~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~---~~ 153 (340)
|+|....|++++.|+.|++||...-....-++ ....++.++.|+|.|.+|+++... +++||+.+.++...- ..
T Consensus 180 FHPre~ILiS~srD~tvKlFDfsK~saKrA~K~~qd~~~vrsiSfHPsGefllvgTdHp~~rlYdv~T~QcfvsanPd~q 259 (430)
T KOG0640|consen 180 FHPRETILISGSRDNTVKLFDFSKTSAKRAFKVFQDTEPVRSISFHPSGEFLLVGTDHPTLRLYDVNTYQCFVSANPDDQ 259 (430)
T ss_pred ecchhheEEeccCCCeEEEEecccHHHHHHHHHhhccceeeeEeecCCCceEEEecCCCceeEEeccceeEeeecCcccc
Confidence 99999999999999999999987544332222 245689999999999999887655 999999988765433 56
Q ss_pred CCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEE
Q 036605 154 DVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSW 233 (340)
Q Consensus 154 ~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vw 233 (340)
|.+.|+++.+++.++..++++. ||.|++||= -+...+..+. ..|....+ +...| ..+++++++.+.|..+++|
T Consensus 260 ht~ai~~V~Ys~t~~lYvTaSk-DG~IklwDG--VS~rCv~t~~--~AH~gsev-cSa~F-tkn~kyiLsSG~DS~vkLW 332 (430)
T KOG0640|consen 260 HTGAITQVRYSSTGSLYVTASK-DGAIKLWDG--VSNRCVRTIG--NAHGGSEV-CSAVF-TKNGKYILSSGKDSTVKLW 332 (430)
T ss_pred cccceeEEEecCCccEEEEecc-CCcEEeecc--ccHHHHHHHH--hhcCCcee-eeEEE-ccCCeEEeecCCcceeeee
Confidence 8899999999999998888777 999999995 3333333332 23333322 22245 8999999999999999999
Q ss_pred ECCCCCccC
Q 036605 234 DLKTVSQDE 242 (340)
Q Consensus 234 d~~~~~~~~ 242 (340)
.+.+++.+.
T Consensus 333 Ei~t~R~l~ 341 (430)
T KOG0640|consen 333 EISTGRMLK 341 (430)
T ss_pred eecCCceEE
Confidence 999877665
No 60
>KOG0292 consensus Vesicle coat complex COPI, alpha subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.93 E-value=1.3e-24 Score=192.69 Aligned_cols=204 Identities=12% Similarity=0.087 Sum_probs=175.0
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEE
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASE 99 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~ 99 (340)
-+.+|..++|+|... .++++--+|.|++||.+-+.++.+|.. |.++|.+++|+|.+..+++||+|-.|++
T Consensus 8 kSsRvKglsFHP~rP---------wILtslHsG~IQlWDYRM~tli~rFde-HdGpVRgv~FH~~qplFVSGGDDykIkV 77 (1202)
T KOG0292|consen 8 KSSRVKGLSFHPKRP---------WILTSLHSGVIQLWDYRMGTLIDRFDE-HDGPVRGVDFHPTQPLFVSGGDDYKIKV 77 (1202)
T ss_pred ccccccceecCCCCC---------EEEEeecCceeeeehhhhhhHHhhhhc-cCCccceeeecCCCCeEEecCCccEEEE
Confidence 467899999999888 999999999999999999999999999 9999999999999999999999999999
Q ss_pred EeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCC
Q 036605 100 MKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGE 177 (340)
Q Consensus 100 wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d 177 (340)
|+..+.+.+.++.+|-..|..+.|++...++++++.+ |+||+..+++++..+++|...|.+.+|+|....+++++. |
T Consensus 78 WnYk~rrclftL~GHlDYVRt~~FHheyPWIlSASDDQTIrIWNwqsr~~iavltGHnHYVMcAqFhptEDlIVSaSL-D 156 (1202)
T KOG0292|consen 78 WNYKTRRCLFTLLGHLDYVRTVFFHHEYPWILSASDDQTIRIWNWQSRKCIAVLTGHNHYVMCAQFHPTEDLIVSASL-D 156 (1202)
T ss_pred EecccceehhhhccccceeEEeeccCCCceEEEccCCCeEEEEeccCCceEEEEecCceEEEeeccCCccceEEEecc-c
Confidence 9999999999999999999999999999999987665 999999999999999999999999999999889999888 9
Q ss_pred CeEEEEEccCCCCCccCCc-----------------------e-eeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEE
Q 036605 178 KHLQVWRCDISSKTVNKGP-----------------------A-LSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSW 233 (340)
Q Consensus 178 ~~i~iwd~~~~~~~~~~~~-----------------------~-~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vw 233 (340)
.+|+|||+..-.++....- . .-.+|...+..+ +| +|.-..+++|+.|..|++|
T Consensus 157 QTVRVWDisGLRkk~~~pg~~e~~~~~~~~~~dLfg~~DaVVK~VLEGHDRGVNwa--Af-hpTlpliVSG~DDRqVKlW 233 (1202)
T KOG0292|consen 157 QTVRVWDISGLRKKNKAPGSLEDQMRGQQGNSDLFGQTDAVVKHVLEGHDRGVNWA--AF-HPTLPLIVSGADDRQVKLW 233 (1202)
T ss_pred ceEEEEeecchhccCCCCCCchhhhhccccchhhcCCcCeeeeeeecccccccceE--Ee-cCCcceEEecCCcceeeEE
Confidence 9999999831111111100 0 011333333333 55 7888899999999999999
Q ss_pred ECCC
Q 036605 234 DLKT 237 (340)
Q Consensus 234 d~~~ 237 (340)
....
T Consensus 234 rmne 237 (1202)
T KOG0292|consen 234 RMNE 237 (1202)
T ss_pred Eecc
Confidence 8765
No 61
>PLN00181 protein SPA1-RELATED; Provisional
Probab=99.93 E-value=1.3e-23 Score=200.47 Aligned_cols=202 Identities=14% Similarity=0.158 Sum_probs=161.8
Q ss_pred CCCeEEEEeecc-ccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEec-CCCEEEEEeCCCcEE
Q 036605 21 VVSYSCLACGFV-GKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAK-KGRSLHVVGTNGMAS 98 (340)
Q Consensus 21 ~~~v~~l~~sp~-~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~-~~~~l~s~~~dg~i~ 98 (340)
...+.+++|+|. +. +|++++.||+|++||+.+++.+..+.+ |.+.|++++|+| ++.+|++|+.|+.|+
T Consensus 532 ~~~v~~l~~~~~~~~---------~las~~~Dg~v~lWd~~~~~~~~~~~~-H~~~V~~l~~~p~~~~~L~Sgs~Dg~v~ 601 (793)
T PLN00181 532 RSKLSGICWNSYIKS---------QVASSNFEGVVQVWDVARSQLVTEMKE-HEKRVWSIDYSSADPTLLASGSDDGSVK 601 (793)
T ss_pred cCceeeEEeccCCCC---------EEEEEeCCCeEEEEECCCCeEEEEecC-CCCCEEEEEEcCCCCCEEEEEcCCCEEE
Confidence 467899999875 46 899999999999999999998888888 999999999997 788999999999999
Q ss_pred EEeCCCCeEEEEeecCCCCeeEEEEc-cCCCEEEEecCc--EEEEECCCCc-eeEEeecCCCCeEEEEECCCCCEEEEEE
Q 036605 99 EMKSEMGEVIREFKASEKPISSSAFL-CEEKIFALASSE--VRILSLENGE-EVLKFSDDVGPLQYVSASDGAKIIITAG 174 (340)
Q Consensus 99 ~wd~~~~~~~~~~~~~~~~i~~l~~~-~~~~~l~~~~~~--i~i~d~~~~~-~~~~~~~~~~~v~~~~~s~~~~~l~s~~ 174 (340)
+||+.++..+..+..+ ..+.++.|+ +++.++++++.+ |++||+++.+ .+..+.+|...|..+.|. ++.+|++++
T Consensus 602 iWd~~~~~~~~~~~~~-~~v~~v~~~~~~g~~latgs~dg~I~iwD~~~~~~~~~~~~~h~~~V~~v~f~-~~~~lvs~s 679 (793)
T PLN00181 602 LWSINQGVSIGTIKTK-ANICCVQFPSESGRSLAFGSADHKVYYYDLRNPKLPLCTMIGHSKTVSYVRFV-DSSTLVSSS 679 (793)
T ss_pred EEECCCCcEEEEEecC-CCeEEEEEeCCCCCEEEEEeCCCeEEEEECCCCCccceEecCCCCCEEEEEEe-CCCEEEEEE
Confidence 9999999888887754 578999995 568888886554 9999998765 466778999999999997 677899988
Q ss_pred cCCCeEEEEEccCCCCCcc-CCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 175 YGEKHLQVWRCDISSKTVN-KGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 175 ~~d~~i~iwd~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
. |+.|++||++....... ..+....+|...+..+ .+ ++++.+|++|+.||.|++|+....
T Consensus 680 ~-D~~ikiWd~~~~~~~~~~~~l~~~~gh~~~i~~v--~~-s~~~~~lasgs~D~~v~iw~~~~~ 740 (793)
T PLN00181 680 T-DNTLKLWDLSMSISGINETPLHSFMGHTNVKNFV--GL-SVSDGYIATGSETNEVFVYHKAFP 740 (793)
T ss_pred C-CCEEEEEeCCCCccccCCcceEEEcCCCCCeeEE--EE-cCCCCEEEEEeCCCEEEEEECCCC
Confidence 7 99999999852211100 1111111454444333 44 788899999999999999997654
No 62
>KOG0277 consensus Peroxisomal targeting signal type 2 receptor [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.93 E-value=8.5e-25 Score=167.97 Aligned_cols=215 Identities=11% Similarity=0.117 Sum_probs=168.0
Q ss_pred CccCC-CCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEE
Q 036605 1 IWSTN-DGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGL 79 (340)
Q Consensus 1 vwd~~-~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v 79 (340)
|||+. ....+..|+ .|..+|.++.|++..+ ..+++++.||+|++|+...++.+.++.+ |...|...
T Consensus 87 l~d~~~~s~Pi~~~k----EH~~EV~Svdwn~~~r--------~~~ltsSWD~TiKLW~~~r~~Sv~Tf~g-h~~~Iy~a 153 (311)
T KOG0277|consen 87 LFDLTMPSKPIHKFK----EHKREVYSVDWNTVRR--------RIFLTSSWDGTIKLWDPNRPNSVQTFNG-HNSCIYQA 153 (311)
T ss_pred EeccCCCCcchhHHH----hhhhheEEeccccccc--------eeEEeeccCCceEeecCCCCcceEeecC-CccEEEEE
Confidence 45543 233556666 7999999999998763 1688889999999999999999999999 99999999
Q ss_pred EEec-CCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCC-CEEEEecCc--EEEEECCCCc-eeEEeecC
Q 036605 80 AFAK-KGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEE-KIFALASSE--VRILSLENGE-EVLKFSDD 154 (340)
Q Consensus 80 ~~~~-~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~-~~l~~~~~~--i~i~d~~~~~-~~~~~~~~ 154 (340)
.|+| ..+.+++++.|+.+++||++.......+..|...+.++.|+.-. ..+++++.+ |++||+++.+ ++..+.+|
T Consensus 154 ~~sp~~~nlfas~Sgd~~l~lwdvr~~gk~~~i~ah~~Eil~cdw~ky~~~vl~Tg~vd~~vr~wDir~~r~pl~eL~gh 233 (311)
T KOG0277|consen 154 AFSPHIPNLFASASGDGTLRLWDVRSPGKFMSIEAHNSEILCCDWSKYNHNVLATGGVDNLVRGWDIRNLRTPLFELNGH 233 (311)
T ss_pred ecCCCCCCeEEEccCCceEEEEEecCCCceeEEEeccceeEeecccccCCcEEEecCCCceEEEEehhhccccceeecCC
Confidence 9999 56799999999999999998655445588999999999999855 455666555 9999998754 56788999
Q ss_pred CCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCC-CccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEE
Q 036605 155 VGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSK-TVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSW 233 (340)
Q Consensus 155 ~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vw 233 (340)
.-.|+.+.|||...-++++++-|-+++|||.. .+ ....... .|...+..+ -|+.-++.++++.+.|+.++||
T Consensus 234 ~~AVRkvk~Sph~~~lLaSasYDmT~riw~~~--~~ds~~e~~~---~HtEFv~g~--Dws~~~~~~vAs~gWDe~l~Vw 306 (311)
T KOG0277|consen 234 GLAVRKVKFSPHHASLLASASYDMTVRIWDPE--RQDSAIETVD---HHTEFVCGL--DWSLFDPGQVASTGWDELLYVW 306 (311)
T ss_pred ceEEEEEecCcchhhHhhhccccceEEecccc--cchhhhhhhh---ccceEEecc--ccccccCceeeecccccceeee
Confidence 99999999999866555444449999999983 22 1122222 455555555 4544578899999999999999
Q ss_pred EC
Q 036605 234 DL 235 (340)
Q Consensus 234 d~ 235 (340)
+-
T Consensus 307 ~p 308 (311)
T KOG0277|consen 307 NP 308 (311)
T ss_pred cc
Confidence 84
No 63
>KOG0293 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.93 E-value=9.8e-25 Score=178.24 Aligned_cols=215 Identities=18% Similarity=0.210 Sum_probs=176.6
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
+||+.+|.+...|. .++...+.|++|.|||. .+++|+.|++|..||+. |+....+++.....|.+++
T Consensus 295 lwDv~tgd~~~~y~---~~~~~S~~sc~W~pDg~---------~~V~Gs~dr~i~~wdlD-gn~~~~W~gvr~~~v~dla 361 (519)
T KOG0293|consen 295 LWDVDTGDLRHLYP---SGLGFSVSSCAWCPDGF---------RFVTGSPDRTIIMWDLD-GNILGNWEGVRDPKVHDLA 361 (519)
T ss_pred eccCCcchhhhhcc---cCcCCCcceeEEccCCc---------eeEecCCCCcEEEecCC-cchhhcccccccceeEEEE
Confidence 69999999998887 45778999999999998 79999999999999986 4456667764556799999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE--ecCcEEEEECCCCceeEEeecCCCC-
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL--ASSEVRILSLENGEEVLKFSDDVGP- 157 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~--~~~~i~i~d~~~~~~~~~~~~~~~~- 157 (340)
..+||+++++.+.|..|++++..+....... ....+|+++++|.+++++++ .+..+++||++..+.++++.+|...
T Consensus 362 it~Dgk~vl~v~~d~~i~l~~~e~~~dr~li-se~~~its~~iS~d~k~~LvnL~~qei~LWDl~e~~lv~kY~Ghkq~~ 440 (519)
T KOG0293|consen 362 ITYDGKYVLLVTVDKKIRLYNREARVDRGLI-SEEQPITSFSISKDGKLALVNLQDQEIHLWDLEENKLVRKYFGHKQGH 440 (519)
T ss_pred EcCCCcEEEEEecccceeeechhhhhhhccc-cccCceeEEEEcCCCcEEEEEcccCeeEEeecchhhHHHHhhcccccc
Confidence 9999999999999999999998765443333 34668999999999999877 5666999999988888999888743
Q ss_pred -eEEEEECCC-CCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEEC
Q 036605 158 -LQYVSASDG-AKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDL 235 (340)
Q Consensus 158 -v~~~~~s~~-~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~ 235 (340)
+..-+|-.- ..++++|+. |+.|+||+. .++..+..+. +|...+..+ +|.+.+...+|+++.||+|+||..
T Consensus 441 fiIrSCFgg~~~~fiaSGSE-D~kvyIWhr--~sgkll~~Ls---GHs~~vNcV--swNP~~p~m~ASasDDgtIRIWg~ 512 (519)
T KOG0293|consen 441 FIIRSCFGGGNDKFIASGSE-DSKVYIWHR--ISGKLLAVLS---GHSKTVNCV--SWNPADPEMFASASDDGTIRIWGP 512 (519)
T ss_pred eEEEeccCCCCcceEEecCC-CceEEEEEc--cCCceeEeec---CCcceeeEE--ecCCCCHHHhhccCCCCeEEEecC
Confidence 444566543 356666555 999999998 5777777777 898888877 776678888999999999999986
Q ss_pred CC
Q 036605 236 KT 237 (340)
Q Consensus 236 ~~ 237 (340)
..
T Consensus 513 ~~ 514 (519)
T KOG0293|consen 513 SD 514 (519)
T ss_pred Cc
Confidence 53
No 64
>KOG0313 consensus Microtubule binding protein YTM1 (contains WD40 repeats) [Cytoskeleton]
Probab=99.93 E-value=4.7e-24 Score=172.47 Aligned_cols=198 Identities=13% Similarity=0.143 Sum_probs=165.1
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC-------------------------CeeEEEecCCCC
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT-------------------------GEMKWKSTGRHP 73 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~-------------------------~~~~~~~~~~h~ 73 (340)
+|...|-|+...+++. .+++|+.|.+|.||+.++ +..+..+.+ |.
T Consensus 191 GHk~~V~sVsv~~sgt---------r~~SgS~D~~lkiWs~~~~~~~~~E~~s~~rrk~~~~~~~~~~r~P~vtl~G-Ht 260 (423)
T KOG0313|consen 191 GHKRSVDSVSVDSSGT---------RFCSGSWDTMLKIWSVETDEEDELESSSNRRRKKQKREKEGGTRTPLVTLEG-HT 260 (423)
T ss_pred ccccceeEEEecCCCC---------eEEeecccceeeecccCCCccccccccchhhhhhhhhhhcccccCceEEecc-cc
Confidence 8999999999999998 899999999999999321 123445666 99
Q ss_pred CCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCc---ee
Q 036605 74 GGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGE---EV 148 (340)
Q Consensus 74 ~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~---~~ 148 (340)
++|.++.|++ ...+++++.|.+|+.||+.++..+..+.. ...+.++.++|..++|++++.+ +++||.+++. ..
T Consensus 261 ~~Vs~V~w~d-~~v~yS~SwDHTIk~WDletg~~~~~~~~-~ksl~~i~~~~~~~Ll~~gssdr~irl~DPR~~~gs~v~ 338 (423)
T KOG0313|consen 261 EPVSSVVWSD-ATVIYSVSWDHTIKVWDLETGGLKSTLTT-NKSLNCISYSPLSKLLASGSSDRHIRLWDPRTGDGSVVS 338 (423)
T ss_pred cceeeEEEcC-CCceEeecccceEEEEEeecccceeeeec-CcceeEeecccccceeeecCCCCceeecCCCCCCCceeE
Confidence 9999999997 77999999999999999999998888765 5578999999999999887666 9999998763 23
Q ss_pred EEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCC
Q 036605 149 LKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESG 228 (340)
Q Consensus 149 ~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg 228 (340)
..|.+|.+.|.++.|+|...+++.++..|+++++||+|. .+..+-.+. +|...++++ -| .++..+++|+.|.
T Consensus 339 ~s~~gH~nwVssvkwsp~~~~~~~S~S~D~t~klWDvRS-~k~plydI~---~h~DKvl~v--dW--~~~~~IvSGGaD~ 410 (423)
T KOG0313|consen 339 QSLIGHKNWVSSVKWSPTNEFQLVSGSYDNTVKLWDVRS-TKAPLYDIA---GHNDKVLSV--DW--NEGGLIVSGGADN 410 (423)
T ss_pred EeeecchhhhhheecCCCCceEEEEEecCCeEEEEEecc-CCCcceeec---cCCceEEEE--ec--cCCceEEeccCcc
Confidence 788999999999999999888777777799999999973 332333344 777888877 66 6778999999999
Q ss_pred cEEEEECC
Q 036605 229 VAYSWDLK 236 (340)
Q Consensus 229 ~i~vwd~~ 236 (340)
+|+++...
T Consensus 411 ~l~i~~~~ 418 (423)
T KOG0313|consen 411 KLRIFKGS 418 (423)
T ss_pred eEEEeccc
Confidence 99999754
No 65
>KOG0275 consensus Conserved WD40 repeat-containing protein [General function prediction only]
Probab=99.92 E-value=1.5e-25 Score=178.03 Aligned_cols=216 Identities=17% Similarity=0.233 Sum_probs=169.3
Q ss_pred CccCCCCceeeeeeCC----CCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCe
Q 036605 1 IWSTNDGSLLAEWKQP----DGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGL 76 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~----~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v 76 (340)
|||..+|.+...++.. .-.++.+|.|+.||.|.. +||+|+.||.|.+|.+.+|.++++|..+|...|
T Consensus 239 VWny~~GKlrKDLkYQAqd~fMMmd~aVlci~FSRDsE---------MlAsGsqDGkIKvWri~tG~ClRrFdrAHtkGv 309 (508)
T KOG0275|consen 239 VWNYTTGKLRKDLKYQAQDNFMMMDDAVLCISFSRDSE---------MLASGSQDGKIKVWRIETGQCLRRFDRAHTKGV 309 (508)
T ss_pred eehhccchhhhhhhhhhhcceeecccceEEEeecccHH---------HhhccCcCCcEEEEEEecchHHHHhhhhhccCe
Confidence 6999999876433211 125788999999999998 999999999999999999999999997799999
Q ss_pred EEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec--CcEEEEECCCCceeEEeecC
Q 036605 77 AGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALAS--SEVRILSLENGEEVLKFSDD 154 (340)
Q Consensus 77 ~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~--~~i~i~d~~~~~~~~~~~~~ 154 (340)
+|+.|+.|+..+++++.|.++++.-+.+|+.+..|.+|.+.|+...|+++|.++++++ ++|++|+.++.+++.+|...
T Consensus 310 t~l~FSrD~SqiLS~sfD~tvRiHGlKSGK~LKEfrGHsSyvn~a~ft~dG~~iisaSsDgtvkvW~~KtteC~~Tfk~~ 389 (508)
T KOG0275|consen 310 TCLSFSRDNSQILSASFDQTVRIHGLKSGKCLKEFRGHSSYVNEATFTDDGHHIISASSDGTVKVWHGKTTECLSTFKPL 389 (508)
T ss_pred eEEEEccCcchhhcccccceEEEeccccchhHHHhcCccccccceEEcCCCCeEEEecCCccEEEecCcchhhhhhccCC
Confidence 9999999999999999999999999999999999999999999999999999998754 55999999887766554321
Q ss_pred --C---------------------------------------------CCeEEEEECCCCCEEEEEEcCCCeEEEEEccC
Q 036605 155 --V---------------------------------------------GPLQYVSASDGAKIIITAGYGEKHLQVWRCDI 187 (340)
Q Consensus 155 --~---------------------------------------------~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~ 187 (340)
. +...+...+|.|.++++.+. |+.++.|.+
T Consensus 390 ~~d~~vnsv~~~PKnpeh~iVCNrsntv~imn~qGQvVrsfsSGkREgGdFi~~~lSpkGewiYcigE-D~vlYCF~~-- 466 (508)
T KOG0275|consen 390 GTDYPVNSVILLPKNPEHFIVCNRSNTVYIMNMQGQVVRSFSSGKREGGDFINAILSPKGEWIYCIGE-DGVLYCFSV-- 466 (508)
T ss_pred CCcccceeEEEcCCCCceEEEEcCCCeEEEEeccceEEeeeccCCccCCceEEEEecCCCcEEEEEcc-CcEEEEEEe--
Confidence 1 12233444666777777666 777777776
Q ss_pred CCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEE
Q 036605 188 SSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWD 234 (340)
Q Consensus 188 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd 234 (340)
.++.....+. -|...++.+ .. +|....+++-+.||.+++|.
T Consensus 467 ~sG~LE~tl~---VhEkdvIGl--~H-HPHqNllAsYsEDgllKLWk 507 (508)
T KOG0275|consen 467 LSGKLERTLP---VHEKDVIGL--TH-HPHQNLLASYSEDGLLKLWK 507 (508)
T ss_pred ecCceeeeee---ccccccccc--cc-CcccchhhhhcccchhhhcC
Confidence 4444333332 333333333 33 67778889999999999984
No 66
>KOG1407 consensus WD40 repeat protein [Function unknown]
Probab=99.92 E-value=1.5e-23 Score=161.69 Aligned_cols=220 Identities=13% Similarity=0.140 Sum_probs=175.0
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
||+++.+....++... +|.+.|-.++|+|... +++++++.|.+|++||...++....+.. .+.-.-+.
T Consensus 46 v~n~e~~r~~~~~~~~--gh~~svdql~w~~~~~--------d~~atas~dk~ir~wd~r~~k~~~~i~~--~~eni~i~ 113 (313)
T KOG1407|consen 46 VWNLERDRFRKELVYR--GHTDSVDQLCWDPKHP--------DLFATASGDKTIRIWDIRSGKCTARIET--KGENINIT 113 (313)
T ss_pred EEEecchhhhhhhccc--CCCcchhhheeCCCCC--------cceEEecCCceEEEEEeccCcEEEEeec--cCcceEEE
Confidence 4666666655554444 8889999999998772 2899999999999999999998888774 44556789
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE--ecCcEEEEECCCCceeEEeecCCCCe
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL--ASSEVRILSLENGEEVLKFSDDVGPL 158 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~--~~~~i~i~d~~~~~~~~~~~~~~~~v 158 (340)
|+|+|++++.++.|..|...|.++.+.+...+. ...+..++|+-++.+++. |-|.|.|......+++..+..|+..+
T Consensus 114 wsp~g~~~~~~~kdD~it~id~r~~~~~~~~~~-~~e~ne~~w~~~nd~Fflt~GlG~v~ILsypsLkpv~si~AH~snC 192 (313)
T KOG1407|consen 114 WSPDGEYIAVGNKDDRITFIDARTYKIVNEEQF-KFEVNEISWNNSNDLFFLTNGLGCVEILSYPSLKPVQSIKAHPSNC 192 (313)
T ss_pred EcCCCCEEEEecCcccEEEEEecccceeehhcc-cceeeeeeecCCCCEEEEecCCceEEEEeccccccccccccCCcce
Confidence 999999999999999999999998877665542 445677888877777655 33669999999999999999999999
Q ss_pred EEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 159 QYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 159 ~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
.++.|+|+|+||++|+. |..+.+||++ .--..+.+. .+..+ +..+ +| +.+|++|++||+|..|-|-+++++
T Consensus 193 icI~f~p~GryfA~GsA-DAlvSLWD~~--ELiC~R~is-Rldwp--VRTl--SF-S~dg~~lASaSEDh~IDIA~vetG 263 (313)
T KOG1407|consen 193 ICIEFDPDGRYFATGSA-DALVSLWDVD--ELICERCIS-RLDWP--VRTL--SF-SHDGRMLASASEDHFIDIAEVETG 263 (313)
T ss_pred EEEEECCCCceEeeccc-cceeeccChh--Hhhhheeec-cccCc--eEEE--Ee-ccCcceeeccCccceEEeEecccC
Confidence 99999999999999888 9999999983 221112222 12333 3333 45 899999999999999999999999
Q ss_pred CccC
Q 036605 239 SQDE 242 (340)
Q Consensus 239 ~~~~ 242 (340)
.++.
T Consensus 264 d~~~ 267 (313)
T KOG1407|consen 264 DRVW 267 (313)
T ss_pred CeEE
Confidence 8877
No 67
>KOG0283 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.92 E-value=3.9e-24 Score=189.11 Aligned_cols=205 Identities=13% Similarity=0.099 Sum_probs=160.7
Q ss_pred eeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEec-CCCE
Q 036605 9 LLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAK-KGRS 87 (340)
Q Consensus 9 ~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~-~~~~ 87 (340)
.+++|+ +|...|..|.||.++- |++++.|.+|++|++...++++.|. |...|+||+|+| |.++
T Consensus 361 P~~ef~----GHt~DILDlSWSKn~f----------LLSSSMDKTVRLWh~~~~~CL~~F~--HndfVTcVaFnPvDDry 424 (712)
T KOG0283|consen 361 PFCEFK----GHTADILDLSWSKNNF----------LLSSSMDKTVRLWHPGRKECLKVFS--HNDFVTCVAFNPVDDRY 424 (712)
T ss_pred chhhhh----ccchhheecccccCCe----------eEeccccccEEeecCCCcceeeEEe--cCCeeEEEEecccCCCc
Confidence 345566 8999999999997655 9999999999999999999999988 999999999999 8889
Q ss_pred EEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEee--cC------CCC
Q 036605 88 LHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFS--DD------VGP 157 (340)
Q Consensus 88 l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~--~~------~~~ 157 (340)
+++|+-||.|++|++...+++. +..-..-|++++|.|||+..++|.-+ +++|+....+....+. .| ...
T Consensus 425 FiSGSLD~KvRiWsI~d~~Vv~-W~Dl~~lITAvcy~PdGk~avIGt~~G~C~fY~t~~lk~~~~~~I~~~~~Kk~~~~r 503 (712)
T KOG0283|consen 425 FISGSLDGKVRLWSISDKKVVD-WNDLRDLITAVCYSPDGKGAVIGTFNGYCRFYDTEGLKLVSDFHIRLHNKKKKQGKR 503 (712)
T ss_pred EeecccccceEEeecCcCeeEe-ehhhhhhheeEEeccCCceEEEEEeccEEEEEEccCCeEEEeeeEeeccCccccCce
Confidence 9999999999999998777554 44445789999999999999886544 9999998876664432 11 237
Q ss_pred eEEEEECCCCC-EEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECC
Q 036605 158 LQYVSASDGAK-IIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 158 v~~~~~s~~~~-~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
|+.+.|.|... .+++++. |..|+|||.+ ....+..+. ++....-...+.+ ..||.+|++++.|..|++|+..
T Consensus 504 ITG~Q~~p~~~~~vLVTSn-DSrIRI~d~~--~~~lv~KfK---G~~n~~SQ~~Asf-s~Dgk~IVs~seDs~VYiW~~~ 576 (712)
T KOG0283|consen 504 ITGLQFFPGDPDEVLVTSN-DSRIRIYDGR--DKDLVHKFK---GFRNTSSQISASF-SSDGKHIVSASEDSWVYIWKND 576 (712)
T ss_pred eeeeEecCCCCCeEEEecC-CCceEEEecc--chhhhhhhc---ccccCCcceeeeE-ccCCCEEEEeecCceEEEEeCC
Confidence 99999987544 3555466 9999999983 344444443 3322222233355 6799999999999999999985
Q ss_pred C
Q 036605 237 T 237 (340)
Q Consensus 237 ~ 237 (340)
.
T Consensus 577 ~ 577 (712)
T KOG0283|consen 577 S 577 (712)
T ss_pred C
Confidence 4
No 68
>KOG0277 consensus Peroxisomal targeting signal type 2 receptor [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.92 E-value=6.1e-24 Score=163.30 Aligned_cols=203 Identities=13% Similarity=0.129 Sum_probs=160.2
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCC-eeEEEecCCCCCCeEEEEEec-CCCEEEEEeCCCcE
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTG-EMKWKSTGRHPGGLAGLAFAK-KGRSLHVVGTNGMA 97 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~-~~~~~~~~~h~~~v~~v~~~~-~~~~l~s~~~dg~i 97 (340)
-...+..++|+++.. ..+++++.||++++||+... ..+..++. |...|.++.|++ ++..+++++.|++|
T Consensus 59 ~~D~LfdV~Wse~~e--------~~~~~a~GDGSLrl~d~~~~s~Pi~~~kE-H~~EV~Svdwn~~~r~~~ltsSWD~Ti 129 (311)
T KOG0277|consen 59 TEDGLFDVAWSENHE--------NQVIAASGDGSLRLFDLTMPSKPIHKFKE-HKREVYSVDWNTVRRRIFLTSSWDGTI 129 (311)
T ss_pred cccceeEeeecCCCc--------ceEEEEecCceEEEeccCCCCcchhHHHh-hhhheEEeccccccceeEEeeccCCce
Confidence 346788999999873 17999999999999996543 36777787 999999999998 45578888999999
Q ss_pred EEEeCCCCeEEEEeecCCCCeeEEEEccCC-CEEEEecC--cEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEE
Q 036605 98 SEMKSEMGEVIREFKASEKPISSSAFLCEE-KIFALASS--EVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAG 174 (340)
Q Consensus 98 ~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~-~~l~~~~~--~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~ 174 (340)
++|+..-.+.+.+|.+|...|+..+|+|.- ..++++++ .+++||++.......+..|...+.++.|+.-..+++..+
T Consensus 130 KLW~~~r~~Sv~Tf~gh~~~Iy~a~~sp~~~nlfas~Sgd~~l~lwdvr~~gk~~~i~ah~~Eil~cdw~ky~~~vl~Tg 209 (311)
T KOG0277|consen 130 KLWDPNRPNSVQTFNGHNSCIYQAAFSPHIPNLFASASGDGTLRLWDVRSPGKFMSIEAHNSEILCCDWSKYNHNVLATG 209 (311)
T ss_pred EeecCCCCcceEeecCCccEEEEEecCCCCCCeEEEccCCceEEEEEecCCCceeEEEeccceeEeecccccCCcEEEec
Confidence 999999999999999999999999999964 55566544 499999987655556899999999999987666555555
Q ss_pred cCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 175 YGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 175 ~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
..|+.|++||++. -+..+..+ .+|.-.+..+.++. .....|++++.|=+++|||...
T Consensus 210 ~vd~~vr~wDir~-~r~pl~eL---~gh~~AVRkvk~Sp--h~~~lLaSasYDmT~riw~~~~ 266 (311)
T KOG0277|consen 210 GVDNLVRGWDIRN-LRTPLFEL---NGHGLAVRKVKFSP--HHASLLASASYDMTVRIWDPER 266 (311)
T ss_pred CCCceEEEEehhh-ccccceee---cCCceEEEEEecCc--chhhHhhhccccceEEeccccc
Confidence 5599999999962 22222222 37777777773333 4456789999999999999874
No 69
>KOG0318 consensus WD40 repeat stress protein/actin interacting protein [Cytoskeleton]
Probab=99.92 E-value=1.7e-23 Score=175.81 Aligned_cols=216 Identities=17% Similarity=0.158 Sum_probs=177.2
Q ss_pred CCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe--eEEEecCCCCCCeEEEEEe
Q 036605 5 NDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE--MKWKSTGRHPGGLAGLAFA 82 (340)
Q Consensus 5 ~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~--~~~~~~~~h~~~v~~v~~~ 82 (340)
++......|. .|...++-..|||.|. |+|+|...|+|+|||....+ +...++. ..++|..++|+
T Consensus 47 ~~~~~~~iYt----EH~~~vtVAkySPsG~---------yiASGD~sG~vRIWdtt~~~hiLKnef~v-~aG~I~Di~Wd 112 (603)
T KOG0318|consen 47 DNPASVDIYT----EHAHQVTVAKYSPSGF---------YIASGDVSGKVRIWDTTQKEHILKNEFQV-LAGPIKDISWD 112 (603)
T ss_pred CCccceeeec----cccceeEEEEeCCCce---------EEeecCCcCcEEEEeccCcceeeeeeeee-cccccccceeC
Confidence 3444445666 7899999999999999 99999999999999987644 2334444 67899999999
Q ss_pred cCCCEEEEEeCC----CcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEE-EEecCc--EEEEECCCCceeEEeecCC
Q 036605 83 KKGRSLHVVGTN----GMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIF-ALASSE--VRILSLENGEEVLKFSDDV 155 (340)
Q Consensus 83 ~~~~~l~s~~~d----g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l-~~~~~~--i~i~d~~~~~~~~~~~~~~ 155 (340)
.+++.++..++. |.+.+|| +|..+.++.+|...|.+++|-|...+= ++++.+ |.+|+-.--+--.++..|.
T Consensus 113 ~ds~RI~avGEGrerfg~~F~~D--SG~SvGei~GhSr~ins~~~KpsRPfRi~T~sdDn~v~ffeGPPFKFk~s~r~Hs 190 (603)
T KOG0318|consen 113 FDSKRIAAVGEGRERFGHVFLWD--SGNSVGEITGHSRRINSVDFKPSRPFRIATGSDDNTVAFFEGPPFKFKSSFREHS 190 (603)
T ss_pred CCCcEEEEEecCccceeEEEEec--CCCccceeeccceeEeeeeccCCCceEEEeccCCCeEEEeeCCCeeeeecccccc
Confidence 999999887754 4566666 678888999999999999999987764 555554 8888865555556678899
Q ss_pred CCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEEC
Q 036605 156 GPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDL 235 (340)
Q Consensus 156 ~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~ 235 (340)
.-|.++.|+|||.++++++. ||.+.+||= .+++....+.-...|...++.+ +| +||+..+++++.|.+++|||+
T Consensus 191 kFV~~VRysPDG~~Fat~gs-Dgki~iyDG--ktge~vg~l~~~~aHkGsIfal--sW-sPDs~~~~T~SaDkt~KIWdV 264 (603)
T KOG0318|consen 191 KFVNCVRYSPDGSRFATAGS-DGKIYIYDG--KTGEKVGELEDSDAHKGSIFAL--SW-SPDSTQFLTVSADKTIKIWDV 264 (603)
T ss_pred cceeeEEECCCCCeEEEecC-CccEEEEcC--CCccEEEEecCCCCccccEEEE--EE-CCCCceEEEecCCceEEEEEe
Confidence 99999999999999999999 999999996 5666666555455788889988 89 999999999999999999999
Q ss_pred CCCCccC
Q 036605 236 KTVSQDE 242 (340)
Q Consensus 236 ~~~~~~~ 242 (340)
.+.+.+.
T Consensus 265 s~~slv~ 271 (603)
T KOG0318|consen 265 STNSLVS 271 (603)
T ss_pred eccceEE
Confidence 9865554
No 70
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=99.92 E-value=5.2e-24 Score=178.59 Aligned_cols=242 Identities=16% Similarity=0.148 Sum_probs=170.5
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe---------------------------eEEEe---
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE---------------------------MKWKS--- 68 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~---------------------------~~~~~--- 68 (340)
||+..|+++++.|.|. .|++|+.|-+|++||+.... .+..+
T Consensus 165 hgtk~Vsal~~Dp~Ga---------R~~sGs~Dy~v~~wDf~gMdas~~~fr~l~P~E~h~i~sl~ys~Tg~~iLvvsg~ 235 (641)
T KOG0772|consen 165 HGTKIVSALAVDPSGA---------RFVSGSLDYTVKFWDFQGMDASMRSFRQLQPCETHQINSLQYSVTGDQILVVSGS 235 (641)
T ss_pred CCceEEEEeeecCCCc---------eeeeccccceEEEEecccccccchhhhccCcccccccceeeecCCCCeEEEEecC
Confidence 8999999999999997 79999999999999965311 00000
Q ss_pred ----------------------------cCCCCCCeEEEEEecCCC-EEEEEeCCCcEEEEeCCCCeEE-EEee-----c
Q 036605 69 ----------------------------TGRHPGGLAGLAFAKKGR-SLHVVGTNGMASEMKSEMGEVI-REFK-----A 113 (340)
Q Consensus 69 ----------------------------~~~h~~~v~~v~~~~~~~-~l~s~~~dg~i~~wd~~~~~~~-~~~~-----~ 113 (340)
..+|...++|.+|+|+.+ .+++|+.||++++||+...+.. ..++ +
T Consensus 236 aqakl~DRdG~~~~e~~KGDQYI~Dm~nTKGHia~lt~g~whP~~k~~FlT~s~DgtlRiWdv~~~k~q~qVik~k~~~g 315 (641)
T KOG0772|consen 236 AQAKLLDRDGFEIVEFSKGDQYIRDMYNTKGHIAELTCGCWHPDNKEEFLTCSYDGTLRIWDVNNTKSQLQVIKTKPAGG 315 (641)
T ss_pred cceeEEccCCceeeeeeccchhhhhhhccCCceeeeeccccccCcccceEEecCCCcEEEEecCCchhheeEEeeccCCC
Confidence 124888999999999764 7899999999999998765422 2222 2
Q ss_pred CCCCeeEEEEccCCCEEEE--ecCcEEEEECCCCce--eEEe-ecCCC--CeEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 114 SEKPISSSAFLCEEKIFAL--ASSEVRILSLENGEE--VLKF-SDDVG--PLQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 114 ~~~~i~~l~~~~~~~~l~~--~~~~i~i~d~~~~~~--~~~~-~~~~~--~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
..-+++.++|+++|+.+|+ .++.|.+|+..+... ...+ .+|.. .|+++.||+||++|++-+. |+++++||++
T Consensus 316 ~Rv~~tsC~~nrdg~~iAagc~DGSIQ~W~~~~~~v~p~~~vk~AH~~g~~Itsi~FS~dg~~LlSRg~-D~tLKvWDLr 394 (641)
T KOG0772|consen 316 KRVPVTSCAWNRDGKLIAAGCLDGSIQIWDKGSRTVRPVMKVKDAHLPGQDITSISFSYDGNYLLSRGF-DDTLKVWDLR 394 (641)
T ss_pred cccCceeeecCCCcchhhhcccCCceeeeecCCcccccceEeeeccCCCCceeEEEeccccchhhhccC-CCceeeeecc
Confidence 3446889999999999876 566799999855422 1222 56765 8999999999999999888 9999999997
Q ss_pred CCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeC------CCcEEEEECCCCCccCCCCCceEEEeeccccccc
Q 036605 187 ISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAE------SGVAYSWDLKTVSQDEKTNPAKITVKLKKADADQ 260 (340)
Q Consensus 187 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~------dg~i~vwd~~~~~~~~~~~p~~i~~~~~~~~~~~ 260 (340)
. .++.+.... +-+...-.--|+| +|+..+|++|+. .|.+++||..+.+.+..+--....+...
T Consensus 395 q-~kkpL~~~t---gL~t~~~~tdc~F-SPd~kli~TGtS~~~~~~~g~L~f~d~~t~d~v~ki~i~~aSvv~~------ 463 (641)
T KOG0772|consen 395 Q-FKKPLNVRT---GLPTPFPGTDCCF-SPDDKLILTGTSAPNGMTAGTLFFFDRMTLDTVYKIDISTASVVRC------ 463 (641)
T ss_pred c-cccchhhhc---CCCccCCCCcccc-CCCceEEEecccccCCCCCceEEEEeccceeeEEEecCCCceEEEE------
Confidence 3 333333332 2222222233477 999999999864 4789999988876665332222222211
Q ss_pred ccccccccccceeeeeecccccCCCeEEEe
Q 036605 261 QNSVNVKKSRTSIIAARLNDLEADGQKTIT 290 (340)
Q Consensus 261 ~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~ 290 (340)
..+|....|++.. .||.+.++
T Consensus 464 ----~WhpkLNQi~~gs-----gdG~~~vy 484 (641)
T KOG0772|consen 464 ----LWHPKLNQIFAGS-----GDGTAHVY 484 (641)
T ss_pred ----eecchhhheeeec-----CCCceEEE
Confidence 2556555565554 56666666
No 71
>PTZ00421 coronin; Provisional
Probab=99.92 E-value=6.1e-23 Score=182.58 Aligned_cols=199 Identities=13% Similarity=0.142 Sum_probs=147.2
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeE-------------EEecCCCCCCeEEEEEec-CCCE
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMK-------------WKSTGRHPGGLAGLAFAK-KGRS 87 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~-------------~~~~~~h~~~v~~v~~~~-~~~~ 87 (340)
..|.....++++. .+++++.+..+..|+...+..+ ..+.+ |.+.|++++|+| ++++
T Consensus 21 ~~i~~~~~~~d~~---------~~~~~n~~~~a~~w~~~gg~~v~~~~~~G~~~~~~~~l~G-H~~~V~~v~fsP~d~~~ 90 (493)
T PTZ00421 21 LNVTPSTALWDCS---------NTIACNDRFIAVPWQQLGSTAVLKHTDYGKLASNPPILLG-QEGPIIDVAFNPFDPQK 90 (493)
T ss_pred eccccccccCCCC---------CcEeECCceEEEEEecCCceEEeeccccccCCCCCceEeC-CCCCEEEEEEcCCCCCE
Confidence 4555566666754 4666666666666664433221 12455 999999999999 8889
Q ss_pred EEEEeCCCcEEEEeCCCC-------eEEEEeecCCCCeeEEEEccCC-CEEEEec--CcEEEEECCCCceeEEeecCCCC
Q 036605 88 LHVVGTNGMASEMKSEMG-------EVIREFKASEKPISSSAFLCEE-KIFALAS--SEVRILSLENGEEVLKFSDDVGP 157 (340)
Q Consensus 88 l~s~~~dg~i~~wd~~~~-------~~~~~~~~~~~~i~~l~~~~~~-~~l~~~~--~~i~i~d~~~~~~~~~~~~~~~~ 157 (340)
|++|+.|+.|++||+.++ ..+..+.+|...|.+++|+|++ .+|++++ +.|++||+.+++.+..+..|...
T Consensus 91 LaSgS~DgtIkIWdi~~~~~~~~~~~~l~~L~gH~~~V~~l~f~P~~~~iLaSgs~DgtVrIWDl~tg~~~~~l~~h~~~ 170 (493)
T PTZ00421 91 LFTASEDGTIMGWGIPEEGLTQNISDPIVHLQGHTKKVGIVSFHPSAMNVLASAGADMVVNVWDVERGKAVEVIKCHSDQ 170 (493)
T ss_pred EEEEeCCCEEEEEecCCCccccccCcceEEecCCCCcEEEEEeCcCCCCEEEEEeCCCEEEEEECCCCeEEEEEcCCCCc
Confidence 999999999999999765 2456788999999999999986 5777755 44999999999888899999999
Q ss_pred eEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCe-eeeeecCCCCCCCCEEEEEe----CCCcEEE
Q 036605 158 LQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPV-AIDCKNSPNGEDGTVILAVA----ESGVAYS 232 (340)
Q Consensus 158 v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~l~~~s----~dg~i~v 232 (340)
|.+++|+|++.+|++++. |+.|+|||++ +++....+. .|... ...+ .| .+++..+++++ .|+.|++
T Consensus 171 V~sla~spdG~lLatgs~-Dg~IrIwD~r--sg~~v~tl~---~H~~~~~~~~--~w-~~~~~~ivt~G~s~s~Dr~Vkl 241 (493)
T PTZ00421 171 ITSLEWNLDGSLLCTTSK-DKKLNIIDPR--DGTIVSSVE---AHASAKSQRC--LW-AKRKDLIITLGCSKSQQRQIML 241 (493)
T ss_pred eEEEEEECCCCEEEEecC-CCEEEEEECC--CCcEEEEEe---cCCCCcceEE--EE-cCCCCeEEEEecCCCCCCeEEE
Confidence 999999999999999887 9999999995 333322222 34322 1122 44 45555666543 4799999
Q ss_pred EECCCCC
Q 036605 233 WDLKTVS 239 (340)
Q Consensus 233 wd~~~~~ 239 (340)
||+.+..
T Consensus 242 WDlr~~~ 248 (493)
T PTZ00421 242 WDTRKMA 248 (493)
T ss_pred EeCCCCC
Confidence 9997643
No 72
>KOG0274 consensus Cdc4 and related F-box and WD-40 proteins [General function prediction only]
Probab=99.92 E-value=2.5e-23 Score=185.44 Aligned_cols=212 Identities=13% Similarity=0.216 Sum_probs=177.9
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
|||+.+|++...+. +|.+.|.|+...+ . ++++|+.|.+|++|++.++..+..+.+ |.++|+++.
T Consensus 275 vWd~~sg~C~~~l~----gh~stv~~~~~~~--~---------~~~sgs~D~tVkVW~v~n~~~l~l~~~-h~~~V~~v~ 338 (537)
T KOG0274|consen 275 VWDCSTGECTHSLQ----GHTSSVRCLTIDP--F---------LLVSGSRDNTVKVWDVTNGACLNLLRG-HTGPVNCVQ 338 (537)
T ss_pred eEecCCCcEEEEec----CCCceEEEEEccC--c---------eEeeccCCceEEEEeccCcceEEEecc-ccccEEEEE
Confidence 79999999999998 8999999988864 3 678899999999999999999999988 999999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE--ecCcEEEEECCCC-ceeEEeecCCCC
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL--ASSEVRILSLENG-EEVLKFSDDVGP 157 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~--~~~~i~i~d~~~~-~~~~~~~~~~~~ 157 (340)
.+ +..+++|+.|+.|.+||+.+++.+..+.+|...|.++.+.+. ..+++ .++.|++||+.++ +++..+.+|...
T Consensus 339 ~~--~~~lvsgs~d~~v~VW~~~~~~cl~sl~gH~~~V~sl~~~~~-~~~~Sgs~D~~IkvWdl~~~~~c~~tl~~h~~~ 415 (537)
T KOG0274|consen 339 LD--EPLLVSGSYDGTVKVWDPRTGKCLKSLSGHTGRVYSLIVDSE-NRLLSGSLDTTIKVWDLRTKRKCIHTLQGHTSL 415 (537)
T ss_pred ec--CCEEEEEecCceEEEEEhhhceeeeeecCCcceEEEEEecCc-ceEEeeeeccceEeecCCchhhhhhhhcCCccc
Confidence 97 889999999999999999999999999999999999988875 56655 4555999999999 899999999998
Q ss_pred eEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeec-CCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECC
Q 036605 158 LQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMR-HSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 158 v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
+..+.+ .+++|++++. |++|++||. ..++....+. . +...+..+ ......+++++.||.+.+||+.
T Consensus 416 v~~l~~--~~~~Lvs~~a-D~~Ik~WD~--~~~~~~~~~~---~~~~~~v~~l-----~~~~~~il~s~~~~~~~l~dl~ 482 (537)
T KOG0274|consen 416 VSSLLL--RDNFLVSSSA-DGTIKLWDA--EEGECLRTLE---GRHVGGVSAL-----ALGKEEILCSSDDGSVKLWDLR 482 (537)
T ss_pred cccccc--ccceeEeccc-cccEEEeec--ccCceeeeec---cCCcccEEEe-----ecCcceEEEEecCCeeEEEecc
Confidence 876665 4568888777 999999998 5665555444 2 22333333 2224679999999999999999
Q ss_pred CCCccCCC
Q 036605 237 TVSQDEKT 244 (340)
Q Consensus 237 ~~~~~~~~ 244 (340)
++.....+
T Consensus 483 ~~~~~~~l 490 (537)
T KOG0274|consen 483 SGTLIRTL 490 (537)
T ss_pred cCchhhhh
Confidence 98777633
No 73
>KOG0265 consensus U5 snRNP-specific protein-like factor and related proteins [RNA processing and modification]
Probab=99.92 E-value=2e-23 Score=164.03 Aligned_cols=211 Identities=14% Similarity=0.147 Sum_probs=174.1
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
.||.++|+..+.++ .|..-|+.+.-+.-| ..++.+|+.||++++||+++...++++. .+-.++++.
T Consensus 116 ~wD~~tG~~~rk~k----~h~~~vNs~~p~rrg--------~~lv~SgsdD~t~kl~D~R~k~~~~t~~--~kyqltAv~ 181 (338)
T KOG0265|consen 116 GWDAETGKRIRKHK----GHTSFVNSLDPSRRG--------PQLVCSGSDDGTLKLWDIRKKEAIKTFE--NKYQLTAVG 181 (338)
T ss_pred EEecccceeeehhc----cccceeeecCccccC--------CeEEEecCCCceEEEEeecccchhhccc--cceeEEEEE
Confidence 49999999999998 899999988833333 3389999999999999999888777775 355799999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE--ecCcEEEEECCCC----ceeEEeecC
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL--ASSEVRILSLENG----EEVLKFSDD 154 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~--~~~~i~i~d~~~~----~~~~~~~~~ 154 (340)
|..++..+++|+-|+.|++||++.+.....+.+|..+|+.+..+|+|.++.+ .+..+++||.+-. +.+..|.+|
T Consensus 182 f~d~s~qv~sggIdn~ikvWd~r~~d~~~~lsGh~DtIt~lsls~~gs~llsnsMd~tvrvwd~rp~~p~~R~v~if~g~ 261 (338)
T KOG0265|consen 182 FKDTSDQVISGGIDNDIKVWDLRKNDGLYTLSGHADTITGLSLSRYGSFLLSNSMDNTVRVWDVRPFAPSQRCVKIFQGH 261 (338)
T ss_pred ecccccceeeccccCceeeeccccCcceEEeecccCceeeEEeccCCCccccccccceEEEEEecccCCCCceEEEeecc
Confidence 9999999999999999999999999999999999999999999999999988 5666999998643 345666655
Q ss_pred C----CCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcE
Q 036605 155 V----GPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVA 230 (340)
Q Consensus 155 ~----~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i 230 (340)
. ......+|+|++.++-+++. |+.+++||. ......-.+. +|...+..+ .| +|....+++++.|.+|
T Consensus 262 ~hnfeknlL~cswsp~~~~i~ags~-dr~vyvwd~--~~r~~lyklp---Gh~gsvn~~--~F-hp~e~iils~~sdk~i 332 (338)
T KOG0265|consen 262 IHNFEKNLLKCSWSPNGTKITAGSA-DRFVYVWDT--TSRRILYKLP---GHYGSVNEV--DF-HPTEPIILSCSSDKTI 332 (338)
T ss_pred hhhhhhhcceeeccCCCCccccccc-cceEEEeec--ccccEEEEcC---CcceeEEEe--ee-cCCCcEEEEeccCcee
Confidence 4 23456789999999888777 999999997 3333333333 777777777 77 8999999999999999
Q ss_pred EEEE
Q 036605 231 YSWD 234 (340)
Q Consensus 231 ~vwd 234 (340)
++=.
T Consensus 333 ~lge 336 (338)
T KOG0265|consen 333 YLGE 336 (338)
T ss_pred Eeec
Confidence 8743
No 74
>KOG0318 consensus WD40 repeat stress protein/actin interacting protein [Cytoskeleton]
Probab=99.92 E-value=2.3e-22 Score=169.18 Aligned_cols=212 Identities=15% Similarity=0.151 Sum_probs=173.8
Q ss_pred CCceeeeeeCCCCCCCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecC
Q 036605 6 DGSLLAEWKQPDGEPVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKK 84 (340)
Q Consensus 6 ~g~~~~~~~~~~~~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~ 84 (340)
+|.-..++. +|+..|.+++|-|.. - .+++|+.|++|.+|+-..-+....+.. |...|+|+.|+||
T Consensus 136 SG~SvGei~----GhSr~ins~~~KpsRPf---------Ri~T~sdDn~v~ffeGPPFKFk~s~r~-HskFV~~VRysPD 201 (603)
T KOG0318|consen 136 SGNSVGEIT----GHSRRINSVDFKPSRPF---------RIATGSDDNTVAFFEGPPFKFKSSFRE-HSKFVNCVRYSPD 201 (603)
T ss_pred CCCccceee----ccceeEeeeeccCCCce---------EEEeccCCCeEEEeeCCCeeeeecccc-cccceeeEEECCC
Confidence 455556666 899999999999876 3 599999999999998766666667776 9999999999999
Q ss_pred CCEEEEEeCCCcEEEEeCCCCeEEEEee---cCCCCeeEEEEccCCCEEEEe--cCcEEEEECCCCceeEEeecCCC---
Q 036605 85 GRSLHVVGTNGMASEMKSEMGEVIREFK---ASEKPISSSAFLCEEKIFALA--SSEVRILSLENGEEVLKFSDDVG--- 156 (340)
Q Consensus 85 ~~~l~s~~~dg~i~~wd~~~~~~~~~~~---~~~~~i~~l~~~~~~~~l~~~--~~~i~i~d~~~~~~~~~~~~~~~--- 156 (340)
|..+++++.||.|.+||-.+|+.+..+. +|++.|.+++|+||+..++++ +.+++|||..+.+.+.++.-...
T Consensus 202 G~~Fat~gsDgki~iyDGktge~vg~l~~~~aHkGsIfalsWsPDs~~~~T~SaDkt~KIWdVs~~slv~t~~~~~~v~d 281 (603)
T KOG0318|consen 202 GSRFATAGSDGKIYIYDGKTGEKVGELEDSDAHKGSIFALSWSPDSTQFLTVSADKTIKIWDVSTNSLVSTWPMGSTVED 281 (603)
T ss_pred CCeEEEecCCccEEEEcCCCccEEEEecCCCCccccEEEEEECCCCceEEEecCCceEEEEEeeccceEEEeecCCchhc
Confidence 9999999999999999999999999988 899999999999999999884 44599999999998888854332
Q ss_pred CeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECC
Q 036605 157 PLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 157 ~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
.--.+.|. ...|++.+. +|+|.+++. ........+. +|...+..+ .. ++++.+|++|+.||.|.-|+..
T Consensus 282 qqvG~lWq--kd~lItVSl-~G~in~ln~--~d~~~~~~i~---GHnK~ITaL--tv-~~d~~~i~SgsyDG~I~~W~~~ 350 (603)
T KOG0318|consen 282 QQVGCLWQ--KDHLITVSL-SGTINYLNP--SDPSVLKVIS---GHNKSITAL--TV-SPDGKTIYSGSYDGHINSWDSG 350 (603)
T ss_pred eEEEEEEe--CCeEEEEEc-CcEEEEecc--cCCChhheec---ccccceeEE--EE-cCCCCEEEeeccCceEEEEecC
Confidence 22334454 457888788 999999998 3444444444 777766655 44 7899999999999999999999
Q ss_pred CCCccC
Q 036605 237 TVSQDE 242 (340)
Q Consensus 237 ~~~~~~ 242 (340)
++...+
T Consensus 351 ~g~~~~ 356 (603)
T KOG0318|consen 351 SGTSDR 356 (603)
T ss_pred Cccccc
Confidence 876655
No 75
>KOG0643 consensus Translation initiation factor 3, subunit i (eIF-3i)/TGF-beta receptor-interacting protein (TRIP-1) [Translation, ribosomal structure and biogenesis; Signal transduction mechanisms]
Probab=99.91 E-value=9.6e-23 Score=157.83 Aligned_cols=170 Identities=14% Similarity=0.158 Sum_probs=148.4
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
||=..+|+.+.+|. +|.+.|+|++..-+.+ +|++|+.|.++++||+++|+.+..+. ...+|..+.
T Consensus 36 vw~s~nGerlGty~----GHtGavW~~Did~~s~---------~liTGSAD~t~kLWDv~tGk~la~~k--~~~~Vk~~~ 100 (327)
T KOG0643|consen 36 VWYSLNGERLGTYD----GHTGAVWCCDIDWDSK---------HLITGSADQTAKLWDVETGKQLATWK--TNSPVKRVD 100 (327)
T ss_pred EEEecCCceeeeec----CCCceEEEEEecCCcc---------eeeeccccceeEEEEcCCCcEEEEee--cCCeeEEEe
Confidence 46667899999999 9999999999998888 89999999999999999999998887 567899999
Q ss_pred EecCCCEEEEEeCC-----CcEEEEeCC-------CCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCc
Q 036605 81 FAKKGRSLHVVGTN-----GMASEMKSE-------MGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGE 146 (340)
Q Consensus 81 ~~~~~~~l~s~~~d-----g~i~~wd~~-------~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~ 146 (340)
|+++|++++.+..+ +.|.++|++ ..++...+..+.+.++..-|.|-+..++++..+ |.+||+++|+
T Consensus 101 F~~~gn~~l~~tD~~mg~~~~v~~fdi~~~~~~~~s~ep~~kI~t~~skit~a~Wg~l~~~ii~Ghe~G~is~~da~~g~ 180 (327)
T KOG0643|consen 101 FSFGGNLILASTDKQMGYTCFVSVFDIRDDSSDIDSEEPYLKIPTPDSKITSALWGPLGETIIAGHEDGSISIYDARTGK 180 (327)
T ss_pred eccCCcEEEEEehhhcCcceEEEEEEccCChhhhcccCceEEecCCccceeeeeecccCCEEEEecCCCcEEEEEcccCc
Confidence 99999987776543 679999988 344567777778889999999999999997655 9999999986
Q ss_pred ee-EEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 147 EV-LKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 147 ~~-~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
.+ ..-..|...|+.+++++|..++++++. |.+-++||++
T Consensus 181 ~~v~s~~~h~~~Ind~q~s~d~T~FiT~s~-Dttakl~D~~ 220 (327)
T KOG0643|consen 181 ELVDSDEEHSSKINDLQFSRDRTYFITGSK-DTTAKLVDVR 220 (327)
T ss_pred eeeechhhhccccccccccCCcceEEeccc-Cccceeeecc
Confidence 55 445789999999999999999999777 9999999984
No 76
>PTZ00420 coronin; Provisional
Probab=99.91 E-value=2.5e-22 Score=179.61 Aligned_cols=181 Identities=17% Similarity=0.130 Sum_probs=141.4
Q ss_pred EcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecC-CCEEEEEeCCCcEEEEeCCCCe--------EEEEeecCCCCe
Q 036605 48 GTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKK-GRSLHVVGTNGMASEMKSEMGE--------VIREFKASEKPI 118 (340)
Q Consensus 48 g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~-~~~l~s~~~dg~i~~wd~~~~~--------~~~~~~~~~~~i 118 (340)
|+.++.|.+|+......+..+.+ |.+.|.+++|+|+ +.+|++|+.|+.|++||+.++. .+..+.+|...|
T Consensus 50 GG~~gvI~L~~~~r~~~v~~L~g-H~~~V~~lafsP~~~~lLASgS~DgtIrIWDi~t~~~~~~~i~~p~~~L~gH~~~V 128 (568)
T PTZ00420 50 GGLIGAIRLENQMRKPPVIKLKG-HTSSILDLQFNPCFSEILASGSEDLTIRVWEIPHNDESVKEIKDPQCILKGHKKKI 128 (568)
T ss_pred CCceeEEEeeecCCCceEEEEcC-CCCCEEEEEEcCCCCCEEEEEeCCCeEEEEECCCCCccccccccceEEeecCCCcE
Confidence 55678999999877777778888 9999999999996 7899999999999999998642 334577899999
Q ss_pred eEEEEccCCCEE-EEe--cCcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCC
Q 036605 119 SSSAFLCEEKIF-ALA--SSEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKG 195 (340)
Q Consensus 119 ~~l~~~~~~~~l-~~~--~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~ 195 (340)
.+++|+|++..+ +++ ++.|++||+++++.+..+. |...|.+++|+|+|.+|++++. |+.|+|||++ +++....
T Consensus 129 ~sVaf~P~g~~iLaSgS~DgtIrIWDl~tg~~~~~i~-~~~~V~SlswspdG~lLat~s~-D~~IrIwD~R--sg~~i~t 204 (568)
T PTZ00420 129 SIIDWNPMNYYIMCSSGFDSFVNIWDIENEKRAFQIN-MPKKLSSLKWNIKGNLLSGTCV-GKHMHIIDPR--KQEIASS 204 (568)
T ss_pred EEEEECCCCCeEEEEEeCCCeEEEEECCCCcEEEEEe-cCCcEEEEEECCCCCEEEEEec-CCEEEEEECC--CCcEEEE
Confidence 999999998765 454 4559999999998777765 5678999999999999988777 9999999994 4433332
Q ss_pred ceeeecCCCeee--eee-cCCCCCCCCEEEEEeCCC----cEEEEECCC
Q 036605 196 PALSMRHSPVAI--DCK-NSPNGEDGTVILAVAESG----VAYSWDLKT 237 (340)
Q Consensus 196 ~~~~~~~~~~~~--~~~-~~~~~~~~~~l~~~s~dg----~i~vwd~~~ 237 (340)
+. .|..... .+. ..+ ++++.++++++.|+ .|+|||+..
T Consensus 205 l~---gH~g~~~s~~v~~~~f-s~d~~~IlTtG~d~~~~R~VkLWDlr~ 249 (568)
T PTZ00420 205 FH---IHDGGKNTKNIWIDGL-GGDDNYILSTGFSKNNMREMKLWDLKN 249 (568)
T ss_pred Ee---cccCCceeEEEEeeeE-cCCCCEEEEEEcCCCCccEEEEEECCC
Confidence 22 4443221 111 123 57888899888774 799999986
No 77
>KOG0973 consensus Histone transcription regulator HIRA, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=99.91 E-value=2.3e-22 Score=182.52 Aligned_cols=157 Identities=15% Similarity=0.149 Sum_probs=138.3
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEc--CCCcEEEEEccC------------CeeEEEecCCCCCCeEEEEEec
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGT--SNGDILAVDVLT------------GEMKWKSTGRHPGGLAGLAFAK 83 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~--~dg~i~i~d~~~------------~~~~~~~~~~h~~~v~~v~~~~ 83 (340)
.|++..|.+++.+|++. .+|+|+ .||.+.||+.+. .+.+..... |.+.|+|+.|+|
T Consensus 10 ~H~~~~IfSIdv~pdg~---------~~aTgGq~~d~~~~iW~~~~vl~~~~~~~~~l~k~l~~m~~-h~~sv~CVR~S~ 79 (942)
T KOG0973|consen 10 NHNEKSIFSIDVHPDGV---------KFATGGQVLDGGIVIWSQDPVLDEKEEKNENLPKHLCTMDD-HDGSVNCVRFSP 79 (942)
T ss_pred ccCCeeEEEEEecCCce---------eEecCCccccccceeeccccccchhhhhhcccchhheeecc-ccCceeEEEECC
Confidence 47778899999999998 799999 899999998542 224455566 999999999999
Q ss_pred CCCEEEEEeCCCcEEEEeCCC------------------CeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECC
Q 036605 84 KGRSLHVVGTNGMASEMKSEM------------------GEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLE 143 (340)
Q Consensus 84 ~~~~l~s~~~dg~i~~wd~~~------------------~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~ 143 (340)
||++||+|++|+.|.+|.... .+.+..+.+|...|..++|+|++.+|++++-+ |.+|+..
T Consensus 80 dG~~lAsGSDD~~v~iW~~~~~~~~~~fgs~g~~~~vE~wk~~~~l~~H~~DV~Dv~Wsp~~~~lvS~s~DnsViiwn~~ 159 (942)
T KOG0973|consen 80 DGSYLASGSDDRLVMIWERAEIGSGTVFGSTGGAKNVESWKVVSILRGHDSDVLDVNWSPDDSLLVSVSLDNSVIIWNAK 159 (942)
T ss_pred CCCeEeeccCcceEEEeeecccCCcccccccccccccceeeEEEEEecCCCccceeccCCCccEEEEecccceEEEEccc
Confidence 999999999999999998762 12456688999999999999999999996554 9999999
Q ss_pred CCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 144 NGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 144 ~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
+.+.+..+.+|.+.|..+.|.|-|+||++-+. |++|+||+.
T Consensus 160 tF~~~~vl~~H~s~VKGvs~DP~Gky~ASqsd-Drtikvwrt 200 (942)
T KOG0973|consen 160 TFELLKVLRGHQSLVKGVSWDPIGKYFASQSD-DRTLKVWRT 200 (942)
T ss_pred cceeeeeeecccccccceEECCccCeeeeecC-CceEEEEEc
Confidence 99999999999999999999999999999888 999999996
No 78
>KOG0646 consensus WD40 repeat protein [General function prediction only]
Probab=99.91 E-value=6.4e-23 Score=170.10 Aligned_cols=211 Identities=14% Similarity=0.136 Sum_probs=168.5
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEE
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASE 99 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~ 99 (340)
..++|.|++-+|+|. +|+.|+..|.|++|.+.+|.++..+.. |-..|+|+.|+.||.+|++||.||.|.+
T Consensus 80 ~Pg~v~al~s~n~G~---------~l~ag~i~g~lYlWelssG~LL~v~~a-HYQ~ITcL~fs~dgs~iiTgskDg~V~v 149 (476)
T KOG0646|consen 80 LPGPVHALASSNLGY---------FLLAGTISGNLYLWELSSGILLNVLSA-HYQSITCLKFSDDGSHIITGSKDGAVLV 149 (476)
T ss_pred cccceeeeecCCCce---------EEEeecccCcEEEEEeccccHHHHHHh-hccceeEEEEeCCCcEEEecCCCccEEE
Confidence 457899999999999 999999999999999999999988877 9999999999999999999999999999
Q ss_pred EeCC---------CCeEEEEeecCCCCeeEEEEccCC--CEEEE--ecCcEEEEECCCCceeEEeecCCCCeEEEEECCC
Q 036605 100 MKSE---------MGEVIREFKASEKPISSSAFLCEE--KIFAL--ASSEVRILSLENGEEVLKFSDDVGPLQYVSASDG 166 (340)
Q Consensus 100 wd~~---------~~~~~~~~~~~~~~i~~l~~~~~~--~~l~~--~~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~ 166 (340)
|++. +-++++.|..|.-+|+++...+.| ..+++ .|+++++||+..+..+.++. .+..+.+++.+|.
T Consensus 150 W~l~~lv~a~~~~~~~p~~~f~~HtlsITDl~ig~Gg~~~rl~TaS~D~t~k~wdlS~g~LLlti~-fp~si~av~lDpa 228 (476)
T KOG0646|consen 150 WLLTDLVSADNDHSVKPLHIFSDHTLSITDLQIGSGGTNARLYTASEDRTIKLWDLSLGVLLLTIT-FPSSIKAVALDPA 228 (476)
T ss_pred EEEEeecccccCCCccceeeeccCcceeEEEEecCCCccceEEEecCCceEEEEEeccceeeEEEe-cCCcceeEEEccc
Confidence 9853 335678899999999999988764 45555 45559999999998887775 3578999999999
Q ss_pred CCEEEEEEcCCCeEEEEEccCCCCCcc-----------CCceeeecCCC--eeeeeecCCCCCCCCEEEEEeCCCcEEEE
Q 036605 167 AKIIITAGYGEKHLQVWRCDISSKTVN-----------KGPALSMRHSP--VAIDCKNSPNGEDGTVILAVAESGVAYSW 233 (340)
Q Consensus 167 ~~~l~s~~~~d~~i~iwd~~~~~~~~~-----------~~~~~~~~~~~--~~~~~~~~~~~~~~~~l~~~s~dg~i~vw 233 (340)
++.++.|+. +|.|.+.++-...++.. .......+|.. .+..+ .. +-||..|++|+.||.|+||
T Consensus 229 e~~~yiGt~-~G~I~~~~~~~~~~~~~~v~~k~~~~~~t~~~~~~Gh~~~~~ITcL--ai-s~DgtlLlSGd~dg~VcvW 304 (476)
T KOG0646|consen 229 ERVVYIGTE-EGKIFQNLLFKLSGQSAGVNQKGRHEENTQINVLVGHENESAITCL--AI-STDGTLLLSGDEDGKVCVW 304 (476)
T ss_pred ccEEEecCC-cceEEeeehhcCCcccccccccccccccceeeeeccccCCcceeEE--EE-ecCccEEEeeCCCCCEEEE
Confidence 999999877 99999988732221111 11111224544 22222 22 6899999999999999999
Q ss_pred ECCCCCccCCCC
Q 036605 234 DLKTVSQDEKTN 245 (340)
Q Consensus 234 d~~~~~~~~~~~ 245 (340)
|+.+.+.+..+.
T Consensus 305 di~S~Q~iRtl~ 316 (476)
T KOG0646|consen 305 DIYSKQCIRTLQ 316 (476)
T ss_pred ecchHHHHHHHh
Confidence 999876665444
No 79
>KOG0306 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.91 E-value=3.3e-23 Score=180.95 Aligned_cols=215 Identities=12% Similarity=0.126 Sum_probs=177.7
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC-----CeeEEEecC-----
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT-----GEMKWKSTG----- 70 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~-----~~~~~~~~~----- 70 (340)
|||+.++.++.+.. .|++.++.++.+||++ .+++|+.|.+|++||..- |.....+.-
T Consensus 438 vfdlaS~~l~Eti~----AHdgaIWsi~~~pD~~---------g~vT~saDktVkfWdf~l~~~~~gt~~k~lsl~~~rt 504 (888)
T KOG0306|consen 438 VFDLASASLVETIR----AHDGAIWSISLSPDNK---------GFVTGSADKTVKFWDFKLVVSVPGTQKKVLSLKHTRT 504 (888)
T ss_pred EEEeehhhhhhhhh----ccccceeeeeecCCCC---------ceEEecCCcEEEEEeEEEEeccCcccceeeeeccceE
Confidence 46666777776666 7999999999999998 899999999999999641 211111111
Q ss_pred -CCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec--CcEEEEECCCCce
Q 036605 71 -RHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALAS--SEVRILSLENGEE 147 (340)
Q Consensus 71 -~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~--~~i~i~d~~~~~~ 147 (340)
.-+..|.|+++||||++|+.+--|.+|++|-+.+-+....+.+|.-||.|+.++||++.+++++ ..|++|-+.-|.+
T Consensus 505 Lel~ddvL~v~~Spdgk~LaVsLLdnTVkVyflDtlKFflsLYGHkLPV~smDIS~DSklivTgSADKnVKiWGLdFGDC 584 (888)
T KOG0306|consen 505 LELEDDVLCVSVSPDGKLLAVSLLDNTVKVYFLDTLKFFLSLYGHKLPVLSMDISPDSKLIVTGSADKNVKIWGLDFGDC 584 (888)
T ss_pred EeccccEEEEEEcCCCcEEEEEeccCeEEEEEecceeeeeeecccccceeEEeccCCcCeEEeccCCCceEEeccccchh
Confidence 1456899999999999999999999999999999999889999999999999999999999955 4499999999999
Q ss_pred eEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCC
Q 036605 148 VLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAES 227 (340)
Q Consensus 148 ~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~d 227 (340)
-..|-+|...|.++.|-|....++++|. |+.|+-||- ..-+.+..+. +|...+... +. .|+|.+++++|.|
T Consensus 585 HKS~fAHdDSvm~V~F~P~~~~FFt~gK-D~kvKqWDg--~kFe~iq~L~---~H~~ev~cL--av-~~~G~~vvs~shD 655 (888)
T KOG0306|consen 585 HKSFFAHDDSVMSVQFLPKTHLFFTCGK-DGKVKQWDG--EKFEEIQKLD---GHHSEVWCL--AV-SPNGSFVVSSSHD 655 (888)
T ss_pred hhhhhcccCceeEEEEcccceeEEEecC-cceEEeech--hhhhhheeec---cchheeeee--EE-cCCCCeEEeccCC
Confidence 9999999999999999999888888887 999999996 3333333333 565555444 34 7999999999999
Q ss_pred CcEEEEECCC
Q 036605 228 GVAYSWDLKT 237 (340)
Q Consensus 228 g~i~vwd~~~ 237 (340)
..|++|.-..
T Consensus 656 ~sIRlwE~td 665 (888)
T KOG0306|consen 656 KSIRLWERTD 665 (888)
T ss_pred ceeEeeeccC
Confidence 9999997654
No 80
>KOG0313 consensus Microtubule binding protein YTM1 (contains WD40 repeats) [Cytoskeleton]
Probab=99.91 E-value=1.6e-22 Score=163.68 Aligned_cols=223 Identities=13% Similarity=0.177 Sum_probs=172.7
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEE----EecCCCCCCe
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKW----KSTGRHPGGL 76 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~----~~~~~h~~~v 76 (340)
|||. .|+.+.++. +|.+++..++|.-.... ...|++++.|.++++|..+.++..- ...+ |...|
T Consensus 129 iWd~-~Gk~~~~~~----Ght~~ik~v~~v~~n~~------~~~fvsas~Dqtl~Lw~~~~~~~~~~~~~~~~G-Hk~~V 196 (423)
T KOG0313|consen 129 IWDL-KGKSIKTIV----GHTGPIKSVAWVIKNSS------SCLFVSASMDQTLRLWKWNVGENKVKALKVCRG-HKRSV 196 (423)
T ss_pred EEec-CCceEEEEe----cCCcceeeeEEEecCCc------cceEEEecCCceEEEEEecCchhhhhHHhHhcc-cccce
Confidence 4665 577777887 99999998888543320 1169999999999999988876332 2235 99999
Q ss_pred EEEEEecCCCEEEEEeCCCcEEEEeCCC-------------------------CeEEEEeecCCCCeeEEEEccCCCEEE
Q 036605 77 AGLAFAKKGRSLHVVGTNGMASEMKSEM-------------------------GEVIREFKASEKPISSSAFLCEEKIFA 131 (340)
Q Consensus 77 ~~v~~~~~~~~l~s~~~dg~i~~wd~~~-------------------------~~~~~~~~~~~~~i~~l~~~~~~~~l~ 131 (340)
-+++..++|..+++|+.|..|.+|+..+ +.++..+.+|..+|.++.|++.+ .++
T Consensus 197 ~sVsv~~sgtr~~SgS~D~~lkiWs~~~~~~~~~E~~s~~rrk~~~~~~~~~~r~P~vtl~GHt~~Vs~V~w~d~~-v~y 275 (423)
T KOG0313|consen 197 DSVSVDSSGTRFCSGSWDTMLKIWSVETDEEDELESSSNRRRKKQKREKEGGTRTPLVTLEGHTEPVSSVVWSDAT-VIY 275 (423)
T ss_pred eEEEecCCCCeEEeecccceeeecccCCCccccccccchhhhhhhhhhhcccccCceEEecccccceeeEEEcCCC-ceE
Confidence 9999999999999999999999999321 23456688999999999999944 444
Q ss_pred E--ecCcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeee
Q 036605 132 L--ASSEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDC 209 (340)
Q Consensus 132 ~--~~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~ 209 (340)
+ .|.+|+.||+.++.....+.. .....++.++|....|++++. |..+++||.|...+... ...-.+|..++..+
T Consensus 276 S~SwDHTIk~WDletg~~~~~~~~-~ksl~~i~~~~~~~Ll~~gss-dr~irl~DPR~~~gs~v--~~s~~gH~nwVssv 351 (423)
T KOG0313|consen 276 SVSWDHTIKVWDLETGGLKSTLTT-NKSLNCISYSPLSKLLASGSS-DRHIRLWDPRTGDGSVV--SQSLIGHKNWVSSV 351 (423)
T ss_pred eecccceEEEEEeecccceeeeec-CcceeEeecccccceeeecCC-CCceeecCCCCCCCcee--EEeeecchhhhhhe
Confidence 4 566699999999988777654 467899999999988998877 99999999864433221 11223788888877
Q ss_pred ecCCCCCCCCEEEEEeCCCcEEEEECCCCC-ccC
Q 036605 210 KNSPNGEDGTVILAVAESGVAYSWDLKTVS-QDE 242 (340)
Q Consensus 210 ~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~-~~~ 242 (340)
.|...+...|++|+.|+++++||+++.. .+.
T Consensus 352 --kwsp~~~~~~~S~S~D~t~klWDvRS~k~ply 383 (423)
T KOG0313|consen 352 --KWSPTNEFQLVSGSYDNTVKLWDVRSTKAPLY 383 (423)
T ss_pred --ecCCCCceEEEEEecCCeEEEEEeccCCCcce
Confidence 6745566778999999999999998755 444
No 81
>KOG0973 consensus Histone transcription regulator HIRA, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=99.91 E-value=1.7e-22 Score=183.39 Aligned_cols=202 Identities=14% Similarity=0.141 Sum_probs=162.7
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC------------------CeeEEEecCCCCCCeEEEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT------------------GEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~------------------~~~~~~~~~~h~~~v~~v~ 80 (340)
.|.+.|+|+.|+|||+ +||+|+.|+.|.||.... -+....+.+ |.+.|..++
T Consensus 67 ~h~~sv~CVR~S~dG~---------~lAsGSDD~~v~iW~~~~~~~~~~fgs~g~~~~vE~wk~~~~l~~-H~~DV~Dv~ 136 (942)
T KOG0973|consen 67 DHDGSVNCVRFSPDGS---------YLASGSDDRLVMIWERAEIGSGTVFGSTGGAKNVESWKVVSILRG-HDSDVLDVN 136 (942)
T ss_pred cccCceeEEEECCCCC---------eEeeccCcceEEEeeecccCCcccccccccccccceeeEEEEEec-CCCccceec
Confidence 7999999999999999 999999999999999762 124556677 999999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec--CcEEEEECCCCce-----------
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALAS--SEVRILSLENGEE----------- 147 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~--~~i~i~d~~~~~~----------- 147 (340)
|+|++.+|++++.|++|.+|+..+.+.+..+.+|...|-.+.|.|-|+++++.+ ++|++|.+.+-..
T Consensus 137 Wsp~~~~lvS~s~DnsViiwn~~tF~~~~vl~~H~s~VKGvs~DP~Gky~ASqsdDrtikvwrt~dw~i~k~It~pf~~~ 216 (942)
T KOG0973|consen 137 WSPDDSLLVSVSLDNSVIIWNAKTFELLKVLRGHQSLVKGVSWDPIGKYFASQSDDRTLKVWRTSDWGIEKSITKPFEES 216 (942)
T ss_pred cCCCccEEEEecccceEEEEccccceeeeeeecccccccceEECCccCeeeeecCCceEEEEEcccceeeEeeccchhhC
Confidence 999999999999999999999999999999999999999999999999999944 4499998543111
Q ss_pred -----------------------------------------eEEeecCCCCeEEEEECCC------C---------CE-E
Q 036605 148 -----------------------------------------VLKFSDDVGPLQYVSASDG------A---------KI-I 170 (340)
Q Consensus 148 -----------------------------------------~~~~~~~~~~v~~~~~s~~------~---------~~-l 170 (340)
-..|.+|..++..++|+|. . .| +
T Consensus 217 ~~~T~f~RlSWSPDG~~las~nA~n~~~~~~~IieR~tWk~~~~LvGH~~p~evvrFnP~lfe~~~~ng~~~~~~~~y~i 296 (942)
T KOG0973|consen 217 PLTTFFLRLSWSPDGHHLASPNAVNGGKSTIAIIERGTWKVDKDLVGHSAPVEVVRFNPKLFERNNKNGTSTQPNCYYCI 296 (942)
T ss_pred CCcceeeecccCCCcCeecchhhccCCcceeEEEecCCceeeeeeecCCCceEEEEeChHHhccccccCCccCCCcceEE
Confidence 1224478899999999763 1 12 5
Q ss_pred EEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 171 ITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 171 ~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
++.|..|+.|.||.. ...+...... .-....+.++ +| +|||..|+++|.||+|.++.+..
T Consensus 297 ~AvgSqDrSlSVW~T--~~~RPl~vi~--~lf~~SI~Dm--sW-spdG~~LfacS~DGtV~~i~Fee 356 (942)
T KOG0973|consen 297 AAVGSQDRSLSVWNT--ALPRPLFVIH--NLFNKSIVDM--SW-SPDGFSLFACSLDGTVALIHFEE 356 (942)
T ss_pred EEEecCCccEEEEec--CCCCchhhhh--hhhcCceeee--eE-cCCCCeEEEEecCCeEEEEEcch
Confidence 666666999999997 2222222111 1233456777 88 99999999999999999999876
No 82
>KOG0264 consensus Nucleosome remodeling factor, subunit CAF1/NURF55/MSI1 [Chromatin structure and dynamics]
Probab=99.91 E-value=1.1e-22 Score=168.19 Aligned_cols=207 Identities=17% Similarity=0.176 Sum_probs=159.2
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe-------eEEEecCCCCCCeEEEEEec-CCCEEEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE-------MKWKSTGRHPGGLAGLAFAK-KGRSLHV 90 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~-------~~~~~~~~h~~~v~~v~~~~-~~~~l~s 90 (340)
+|...-..|+|++... ..|++|+.|++|.+||+.... ....+.+ |...|..++|++ +...+.+
T Consensus 175 gH~~eg~glsWn~~~~--------g~Lls~~~d~~i~lwdi~~~~~~~~~~~p~~~~~~-h~~~VeDV~~h~~h~~lF~s 245 (422)
T KOG0264|consen 175 GHEKEGYGLSWNRQQE--------GTLLSGSDDHTICLWDINAESKEDKVVDPKTIFSG-HEDVVEDVAWHPLHEDLFGS 245 (422)
T ss_pred eecccccccccccccc--------eeEeeccCCCcEEEEeccccccCCccccceEEeec-CCcceehhhccccchhhhee
Confidence 6777778899998763 179999999999999987543 2334566 999999999999 4567888
Q ss_pred EeCCCcEEEEeCC--CCeEEEEeecCCCCeeEEEEccCCCE-EEEe--cCcEEEEECCCCc-eeEEeecCCCCeEEEEEC
Q 036605 91 VGTNGMASEMKSE--MGEVIREFKASEKPISSSAFLCEEKI-FALA--SSEVRILSLENGE-EVLKFSDDVGPLQYVSAS 164 (340)
Q Consensus 91 ~~~dg~i~~wd~~--~~~~~~~~~~~~~~i~~l~~~~~~~~-l~~~--~~~i~i~d~~~~~-~~~~~~~~~~~v~~~~~s 164 (340)
++.|+.+.+||.+ +.+......+|..++.|++|+|-+.+ ||++ +++|.+||+++.. ++..+.+|...|..+.|+
T Consensus 246 v~dd~~L~iwD~R~~~~~~~~~~~ah~~~vn~~~fnp~~~~ilAT~S~D~tV~LwDlRnL~~~lh~~e~H~dev~~V~WS 325 (422)
T KOG0264|consen 246 VGDDGKLMIWDTRSNTSKPSHSVKAHSAEVNCVAFNPFNEFILATGSADKTVALWDLRNLNKPLHTFEGHEDEVFQVEWS 325 (422)
T ss_pred ecCCCeEEEEEcCCCCCCCcccccccCCceeEEEeCCCCCceEEeccCCCcEEEeechhcccCceeccCCCcceEEEEeC
Confidence 9999999999999 45556667889999999999997655 4554 4559999999754 568899999999999999
Q ss_pred CCCCEEEEEEcCCCeEEEEEccCCCCCcc------CCce---eeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEEC
Q 036605 165 DGAKIIITAGYGEKHLQVWRCDISSKTVN------KGPA---LSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDL 235 (340)
Q Consensus 165 ~~~~~l~s~~~~d~~i~iwd~~~~~~~~~------~~~~---~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~ 235 (340)
|+...+++++..|+.+.|||+.....++. .... .--+|...+.++ .|...+.-.+++++.|+.+.||+.
T Consensus 326 Ph~etvLASSg~D~rl~vWDls~ig~eq~~eda~dgppEllF~HgGH~~kV~Df--sWnp~ePW~I~SvaeDN~LqIW~~ 403 (422)
T KOG0264|consen 326 PHNETVLASSGTDRRLNVWDLSRIGEEQSPEDAEDGPPELLFIHGGHTAKVSDF--SWNPNEPWTIASVAEDNILQIWQM 403 (422)
T ss_pred CCCCceeEecccCCcEEEEeccccccccChhhhccCCcceeEEecCcccccccc--cCCCCCCeEEEEecCCceEEEeec
Confidence 98766555555599999999943222221 0111 122566677777 775556667889999999999987
Q ss_pred C
Q 036605 236 K 236 (340)
Q Consensus 236 ~ 236 (340)
.
T Consensus 404 s 404 (422)
T KOG0264|consen 404 A 404 (422)
T ss_pred c
Confidence 6
No 83
>KOG0300 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.91 E-value=7.7e-23 Score=162.21 Aligned_cols=215 Identities=14% Similarity=0.222 Sum_probs=172.2
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEc------cC-------------
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDV------LT------------- 61 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~------~~------------- 61 (340)
||.+++|.++.+|. +|.+.|+|+.|++.+. ++++++.|++.+||.. ..
T Consensus 174 iWs~Esg~CL~~Y~----GH~GSVNsikfh~s~~---------L~lTaSGD~taHIW~~av~~~vP~~~a~~~hSsEeE~ 240 (481)
T KOG0300|consen 174 IWSLESGACLATYT----GHTGSVNSIKFHNSGL---------LLLTASGDETAHIWKAAVNWEVPSNNAPSDHSSEEEE 240 (481)
T ss_pred EEeeccccceeeec----ccccceeeEEeccccc---------eEEEccCCcchHHHHHhhcCcCCCCCCCCCCCchhhh
Confidence 69999999999999 9999999999999999 9999999999999961 10
Q ss_pred -----------------C----eeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeE
Q 036605 62 -----------------G----EMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISS 120 (340)
Q Consensus 62 -----------------~----~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~ 120 (340)
+ ..+..+.+ |.+.|.+..|...|+.+++++.|.+-.+||+++|+++..+.+|....+.
T Consensus 241 e~sDe~~~d~d~~~~sD~~tiRvPl~~ltg-H~~vV~a~dWL~gg~Q~vTaSWDRTAnlwDVEtge~v~~LtGHd~ELtH 319 (481)
T KOG0300|consen 241 EHSDEHNRDTDSSEKSDGHTIRVPLMRLTG-HRAVVSACDWLAGGQQMVTASWDRTANLWDVETGEVVNILTGHDSELTH 319 (481)
T ss_pred hcccccccccccccccCCceeeeeeeeeec-cccceEehhhhcCcceeeeeeccccceeeeeccCceeccccCcchhccc
Confidence 0 12445666 9999999999999999999999999999999999999999999999999
Q ss_pred EEEccCCCEEEEecCc--EEEEECCCC-ceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCce
Q 036605 121 SAFLCEEKIFALASSE--VRILSLENG-EEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPA 197 (340)
Q Consensus 121 l~~~~~~~~l~~~~~~--i~i~d~~~~-~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~ 197 (340)
++-+|..+++++.+++ .++||++.. ..+..|++|...|+++.|.-+. .+++++. |.+|+|||++ +....+..+.
T Consensus 320 cstHptQrLVvTsSrDtTFRLWDFReaI~sV~VFQGHtdtVTS~vF~~dd-~vVSgSD-DrTvKvWdLr-NMRsplATIR 396 (481)
T KOG0300|consen 320 CSTHPTQRLVVTSSRDTTFRLWDFREAIQSVAVFQGHTDTVTSVVFNTDD-RVVSGSD-DRTVKVWDLR-NMRSPLATIR 396 (481)
T ss_pred cccCCcceEEEEeccCceeEeccchhhcceeeeecccccceeEEEEecCC-ceeecCC-CceEEEeeec-cccCcceeee
Confidence 9999999999987776 999999843 3457789999999999998876 5777666 9999999995 2222222222
Q ss_pred eeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCC
Q 036605 198 LSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVS 239 (340)
Q Consensus 198 ~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~ 239 (340)
...+..-+.+ +..+..++.--.+..|++||+....
T Consensus 397 --tdS~~NRvav-----s~g~~iIAiPhDNRqvRlfDlnG~R 431 (481)
T KOG0300|consen 397 --TDSPANRVAV-----SKGHPIIAIPHDNRQVRLFDLNGNR 431 (481)
T ss_pred --cCCccceeEe-----ecCCceEEeccCCceEEEEecCCCc
Confidence 1222223333 3445566666666789999997643
No 84
>KOG0647 consensus mRNA export protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.90 E-value=1.4e-21 Score=153.85 Aligned_cols=210 Identities=14% Similarity=0.171 Sum_probs=153.5
Q ss_pred CCCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccC-CeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCc
Q 036605 19 EPVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLT-GEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGM 96 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~-~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~ 96 (340)
..+..|.+|+|||.. . ++++|+.||+|++|+++. |....+....|.++|.+++|+.||..+++|+.|+.
T Consensus 25 pP~DsIS~l~FSP~~~~---------~~~A~SWD~tVR~wevq~~g~~~~ka~~~~~~PvL~v~WsddgskVf~g~~Dk~ 95 (347)
T KOG0647|consen 25 PPEDSISALAFSPQADN---------LLAAGSWDGTVRIWEVQNSGQLVPKAQQSHDGPVLDVCWSDDGSKVFSGGCDKQ 95 (347)
T ss_pred CcccchheeEeccccCc---------eEEecccCCceEEEEEecCCcccchhhhccCCCeEEEEEccCCceEEeeccCCc
Confidence 567899999999954 5 778999999999999987 44443433349999999999999999999999999
Q ss_pred EEEEeCCCCeEEEEeecCCCCeeEEEEccCCC--EEEEecCc--EEEEECCCCceeEEeec-------------------
Q 036605 97 ASEMKSEMGEVIREFKASEKPISSSAFLCEEK--IFALASSE--VRILSLENGEEVLKFSD------------------- 153 (340)
Q Consensus 97 i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~--~l~~~~~~--i~i~d~~~~~~~~~~~~------------------- 153 (340)
+++||+.+++ +..+..|..+|.++.|-+... .|++++-+ |+.||++...++.++..
T Consensus 96 ~k~wDL~S~Q-~~~v~~Hd~pvkt~~wv~~~~~~cl~TGSWDKTlKfWD~R~~~pv~t~~LPeRvYa~Dv~~pm~vVata 174 (347)
T KOG0647|consen 96 AKLWDLASGQ-VSQVAAHDAPVKTCHWVPGMNYQCLVTGSWDKTLKFWDTRSSNPVATLQLPERVYAADVLYPMAVVATA 174 (347)
T ss_pred eEEEEccCCC-eeeeeecccceeEEEEecCCCcceeEecccccceeecccCCCCeeeeeeccceeeehhccCceeEEEec
Confidence 9999999995 567778999999999988765 66775544 99999987765543321
Q ss_pred ----------------------CCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecC-----CCee
Q 036605 154 ----------------------DVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRH-----SPVA 206 (340)
Q Consensus 154 ----------------------~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~-----~~~~ 206 (340)
....+++++...+....+.++- +|.+.|..++.... ...+.+.... ...+
T Consensus 175 ~r~i~vynL~n~~te~k~~~SpLk~Q~R~va~f~d~~~~alGsi-EGrv~iq~id~~~~--~~nFtFkCHR~~~~~~~~V 251 (347)
T KOG0647|consen 175 ERHIAVYNLENPPTEFKRIESPLKWQTRCVACFQDKDGFALGSI-EGRVAIQYIDDPNP--KDNFTFKCHRSTNSVNDDV 251 (347)
T ss_pred CCcEEEEEcCCCcchhhhhcCcccceeeEEEEEecCCceEeeee-cceEEEEecCCCCc--cCceeEEEeccCCCCCCce
Confidence 0123567776666666677666 88888888853211 2222222111 1113
Q ss_pred eeeec-CCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 207 IDCKN-SPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 207 ~~~~~-~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
..+.. +| +|....|++++.||++.+||-.....+.
T Consensus 252 YaVNsi~F-hP~hgtlvTaGsDGtf~FWDkdar~kLk 287 (347)
T KOG0647|consen 252 YAVNSIAF-HPVHGTLVTAGSDGTFSFWDKDARTKLK 287 (347)
T ss_pred EEecceEe-ecccceEEEecCCceEEEecchhhhhhh
Confidence 33322 34 7888899999999999999987765554
No 85
>KOG0269 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.90 E-value=1.8e-23 Score=183.03 Aligned_cols=217 Identities=14% Similarity=0.210 Sum_probs=172.3
Q ss_pred CccCCC---CceeeeeeCCCCCCCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCe
Q 036605 1 IWSTND---GSLLAEWKQPDGEPVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGL 76 (340)
Q Consensus 1 vwd~~~---g~~~~~~~~~~~~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v 76 (340)
+||+.. ..++..|. .|+..++++.|++.. . +|++|+.||+|++||++..+-..++.+ ....|
T Consensus 114 vWdlnk~~rnk~l~~f~----EH~Rs~~~ldfh~tep~---------iliSGSQDg~vK~~DlR~~~S~~t~~~-nSESi 179 (839)
T KOG0269|consen 114 VWDLNKSIRNKLLTVFN----EHERSANKLDFHSTEPN---------ILISGSQDGTVKCWDLRSKKSKSTFRS-NSESI 179 (839)
T ss_pred EEecCccccchhhhHhh----hhccceeeeeeccCCcc---------EEEecCCCceEEEEeeecccccccccc-cchhh
Confidence 588876 44555666 899999999999887 6 999999999999999999887777777 88899
Q ss_pred EEEEEec-CCCEEEEEeCCCcEEEEeCCCCe-EEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEee
Q 036605 77 AGLAFAK-KGRSLHVVGTNGMASEMKSEMGE-VIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFS 152 (340)
Q Consensus 77 ~~v~~~~-~~~~l~s~~~dg~i~~wd~~~~~-~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~ 152 (340)
.+|.|+| .+..++++.+.|.+.+||++... ....+.+|.++|.|+.|+|++.+||+|+++ |+|||+.+.+.-....
T Consensus 180 RDV~fsp~~~~~F~s~~dsG~lqlWDlRqp~r~~~k~~AH~GpV~c~nwhPnr~~lATGGRDK~vkiWd~t~~~~~~~~t 259 (839)
T KOG0269|consen 180 RDVKFSPGYGNKFASIHDSGYLQLWDLRQPDRCEKKLTAHNGPVLCLNWHPNREWLATGGRDKMVKIWDMTDSRAKPKHT 259 (839)
T ss_pred hceeeccCCCceEEEecCCceEEEeeccCchhHHHHhhcccCceEEEeecCCCceeeecCCCccEEEEeccCCCccceeE
Confidence 9999999 56788888899999999998654 445688999999999999999999999988 9999998765543332
Q ss_pred c-CCCCeEEEEECCCCCEEEEEEc--CCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCc
Q 036605 153 D-DVGPLQYVSASDGAKIIITAGY--GEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGV 229 (340)
Q Consensus 153 ~-~~~~v~~~~~s~~~~~l~s~~~--~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~ 229 (340)
. ...++..+.|-|+..+.++.+. .|-.|+|||++ . ..+ ....-..|.+.+..+ +|.+.+...+.+++.||.
T Consensus 260 InTiapv~rVkWRP~~~~hLAtcsmv~dtsV~VWDvr--R-PYI-P~~t~~eH~~~vt~i--~W~~~d~~~l~s~sKD~t 333 (839)
T KOG0269|consen 260 INTIAPVGRVKWRPARSYHLATCSMVVDTSVHVWDVR--R-PYI-PYATFLEHTDSVTGI--AWDSGDRINLWSCSKDGT 333 (839)
T ss_pred EeecceeeeeeeccCccchhhhhhccccceEEEEeec--c-ccc-cceeeeccCccccce--eccCCCceeeEeecCccH
Confidence 2 3478999999998877654332 37899999994 2 222 222223777777777 786777888999999998
Q ss_pred EEEEECCC
Q 036605 230 AYSWDLKT 237 (340)
Q Consensus 230 i~vwd~~~ 237 (340)
|..-.+++
T Consensus 334 v~qh~~kn 341 (839)
T KOG0269|consen 334 VLQHLFKN 341 (839)
T ss_pred HHHhhhhc
Confidence 87665554
No 86
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=99.90 E-value=3.8e-22 Score=164.14 Aligned_cols=202 Identities=14% Similarity=0.161 Sum_probs=173.1
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEe
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMK 101 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd 101 (340)
..++++...|... .+++|+.|..+.++|...++.+..+.+ |...|+.+.|+|+...+++++.|..|++|.
T Consensus 220 pgi~ald~~~s~~---------~ilTGG~d~~av~~d~~s~q~l~~~~G-h~kki~~v~~~~~~~~v~~aSad~~i~vws 289 (506)
T KOG0289|consen 220 PGITALDIIPSSS---------KILTGGEDKTAVLFDKPSNQILATLKG-HTKKITSVKFHKDLDTVITASADEIIRVWS 289 (506)
T ss_pred CCeeEEeecCCCC---------cceecCCCCceEEEecchhhhhhhccC-cceEEEEEEeccchhheeecCCcceEEeec
Confidence 4567777777655 699999999999999999999999999 999999999999999999999999999999
Q ss_pred CCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeec--CCCCeEEEEECCCCCEEEEEEcCC
Q 036605 102 SEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSD--DVGPLQYVSASDGAKIIITAGYGE 177 (340)
Q Consensus 102 ~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~--~~~~v~~~~~s~~~~~l~s~~~~d 177 (340)
............|..+|+.+..+|.|.||++++.+ .-+.|++++..+..... ..-.+++.+|+|||..|.++.. |
T Consensus 290 ~~~~s~~~~~~~h~~~V~~ls~h~tgeYllsAs~d~~w~Fsd~~~g~~lt~vs~~~s~v~~ts~~fHpDgLifgtgt~-d 368 (506)
T KOG0289|consen 290 VPLSSEPTSSRPHEEPVTGLSLHPTGEYLLSASNDGTWAFSDISSGSQLTVVSDETSDVEYTSAAFHPDGLIFGTGTP-D 368 (506)
T ss_pred cccccCccccccccccceeeeeccCCcEEEEecCCceEEEEEccCCcEEEEEeeccccceeEEeeEcCCceEEeccCC-C
Confidence 98887777788999999999999999999997776 77889999988766643 2245899999999988888666 9
Q ss_pred CeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 178 KHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 178 ~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
+.|+|||+ ..+.....+. +|...+..+ .| +.+|.+|++++.|+.|++||++..+...
T Consensus 369 ~~vkiwdl--ks~~~~a~Fp---ght~~vk~i--~F-sENGY~Lat~add~~V~lwDLRKl~n~k 425 (506)
T KOG0289|consen 369 GVVKIWDL--KSQTNVAKFP---GHTGPVKAI--SF-SENGYWLATAADDGSVKLWDLRKLKNFK 425 (506)
T ss_pred ceEEEEEc--CCccccccCC---CCCCceeEE--Ee-ccCceEEEEEecCCeEEEEEehhhcccc
Confidence 99999999 4444455555 687777777 77 8999999999999999999998866555
No 87
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.90 E-value=1.8e-22 Score=167.10 Aligned_cols=202 Identities=16% Similarity=0.175 Sum_probs=166.0
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
.|...+.|++.|+|++ |||+|+.|..|.||+..+.+.+..+.+ |.+.|.+++|-.....||+++.|..|+
T Consensus 200 ~h~keil~~avS~Dgk---------ylatgg~d~~v~Iw~~~t~ehv~~~~g-hr~~V~~L~fr~gt~~lys~s~Drsvk 269 (479)
T KOG0299|consen 200 GHVKEILTLAVSSDGK---------YLATGGRDRHVQIWDCDTLEHVKVFKG-HRGAVSSLAFRKGTSELYSASADRSVK 269 (479)
T ss_pred cccceeEEEEEcCCCc---------EEEecCCCceEEEecCcccchhhcccc-cccceeeeeeecCccceeeeecCCceE
Confidence 6888999999999999 999999999999999999999999998 999999999998888999999999999
Q ss_pred EEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcC
Q 036605 99 EMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYG 176 (340)
Q Consensus 99 ~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~ 176 (340)
+|+++....+.++.+|+..|.+|....-++.+.+++++ +++|++... .-..|.++.+.+.+++|-.+. .+++++.
T Consensus 270 vw~~~~~s~vetlyGHqd~v~~IdaL~reR~vtVGgrDrT~rlwKi~ee-sqlifrg~~~sidcv~~In~~-HfvsGSd- 346 (479)
T KOG0299|consen 270 VWSIDQLSYVETLYGHQDGVLGIDALSRERCVTVGGRDRTVRLWKIPEE-SQLIFRGGEGSIDCVAFINDE-HFVSGSD- 346 (479)
T ss_pred EEehhHhHHHHHHhCCccceeeechhcccceEEeccccceeEEEecccc-ceeeeeCCCCCeeeEEEeccc-ceeeccC-
Confidence 99999888888899999999999988888777666555 999999443 335678889999999998765 7888777
Q ss_pred CCeEEEEEccCCCCCccCCceeee---------cCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 177 EKHLQVWRCDISSKTVNKGPALSM---------RHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 177 d~~i~iwd~~~~~~~~~~~~~~~~---------~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
+|.|.+|++ ..+..+....... .++.++..+ +. .+....+++|+.+|.|++|.+..+
T Consensus 347 nG~IaLWs~--~KKkplf~~~~AHgv~~~~~~~~~~~Witsl--a~-i~~sdL~asGS~~G~vrLW~i~~g 412 (479)
T KOG0299|consen 347 NGSIALWSL--LKKKPLFTSRLAHGVIPELDPVNGNFWITSL--AV-IPGSDLLASGSWSGCVRLWKIEDG 412 (479)
T ss_pred CceEEEeee--cccCceeEeeccccccCCccccccccceeee--Ee-cccCceEEecCCCCceEEEEecCC
Confidence 999999998 4443332221111 111133333 22 577789999999999999998875
No 88
>KOG0267 consensus Microtubule severing protein katanin p80 subunit B (contains WD40 repeats) [Cell cycle control, cell division, chromosome partitioning]
Probab=99.90 E-value=7.1e-24 Score=184.32 Aligned_cols=209 Identities=15% Similarity=0.209 Sum_probs=180.5
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
.|...|.|+..-..++ .+++|+.|..+-+|.+.....+..|.+ |.++|.++.|+++..+|++|+.+|.|+
T Consensus 26 ~hsaav~~lk~~~s~r---------~~~~Gg~~~k~~L~~i~kp~~i~S~~~-hespIeSl~f~~~E~LlaagsasgtiK 95 (825)
T KOG0267|consen 26 AHSAAVGCLKIRKSSR---------SLVTGGEDEKVNLWAIGKPNAITSLTG-HESPIESLTFDTSERLLAAGSASGTIK 95 (825)
T ss_pred hhhhhhceeeeeccce---------eeccCCCceeeccccccCCchhheeec-cCCcceeeecCcchhhhcccccCCcee
Confidence 6788888888866667 899999999999999877776667787 999999999999999999999999999
Q ss_pred EEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec--CcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcC
Q 036605 99 EMKSEMGEVIREFKASEKPISSSAFLCEEKIFALAS--SEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYG 176 (340)
Q Consensus 99 ~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~--~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~ 176 (340)
+||+..++.++++.+|...+.++.|+|-+.+.+.++ .++++||.+...+...+.+|...+..+.|+|+|++++.++.
T Consensus 96 ~wDleeAk~vrtLtgh~~~~~sv~f~P~~~~~a~gStdtd~~iwD~Rk~Gc~~~~~s~~~vv~~l~lsP~Gr~v~~g~e- 174 (825)
T KOG0267|consen 96 VWDLEEAKIVRTLTGHLLNITSVDFHPYGEFFASGSTDTDLKIWDIRKKGCSHTYKSHTRVVDVLRLSPDGRWVASGGE- 174 (825)
T ss_pred eeehhhhhhhhhhhccccCcceeeeccceEEeccccccccceehhhhccCceeeecCCcceeEEEeecCCCceeeccCC-
Confidence 999999999999999999999999999999997654 44999999977788999999999999999999999999888
Q ss_pred CCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCC
Q 036605 177 EKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 177 d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p 246 (340)
|..++|||+ ..++....+. .|...+..+ -+ +|....++.|+.|+.+++||+++.+.+....|
T Consensus 175 d~tvki~d~--~agk~~~ef~---~~e~~v~sl--e~-hp~e~Lla~Gs~d~tv~f~dletfe~I~s~~~ 236 (825)
T KOG0267|consen 175 DNTVKIWDL--TAGKLSKEFK---SHEGKVQSL--EF-HPLEVLLAPGSSDRTVRFWDLETFEVISSGKP 236 (825)
T ss_pred cceeeeecc--cccccccccc---ccccccccc--cc-CchhhhhccCCCCceeeeeccceeEEeeccCC
Confidence 999999998 5666666665 566666555 34 78888899999999999999997555544444
No 89
>KOG0640 consensus mRNA cleavage stimulating factor complex; subunit 1 [RNA processing and modification]
Probab=99.90 E-value=1.7e-22 Score=159.68 Aligned_cols=162 Identities=11% Similarity=0.140 Sum_probs=137.6
Q ss_pred eeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEE---EecCCCCCCeEEEEEecCC
Q 036605 9 LLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKW---KSTGRHPGGLAGLAFAKKG 85 (340)
Q Consensus 9 ~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~---~~~~~h~~~v~~v~~~~~~ 85 (340)
+++++. .|..+|+++.|+|... +|++|+.|++|++||.......+ .++ ...+|.++.|+|.|
T Consensus 164 vIRTlY----DH~devn~l~FHPre~---------ILiS~srD~tvKlFDfsK~saKrA~K~~q--d~~~vrsiSfHPsG 228 (430)
T KOG0640|consen 164 VIRTLY----DHVDEVNDLDFHPRET---------ILISGSRDNTVKLFDFSKTSAKRAFKVFQ--DTEPVRSISFHPSG 228 (430)
T ss_pred eEeehh----hccCcccceeecchhh---------eEEeccCCCeEEEEecccHHHHHHHHHhh--ccceeeeEeecCCC
Confidence 344554 7899999999999999 99999999999999987654332 233 34579999999999
Q ss_pred CEEEEEeCCCcEEEEeCCCCeEEEEe---ecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEe-ecCC-CCe
Q 036605 86 RSLHVVGTNGMASEMKSEMGEVIREF---KASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKF-SDDV-GPL 158 (340)
Q Consensus 86 ~~l~s~~~dg~i~~wd~~~~~~~~~~---~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~-~~~~-~~v 158 (340)
.+|+.|.....+++||+.+.+....- ..|...|+++.+++.+++.++++.+ |++||--+++++.++ ..|. ..|
T Consensus 229 efllvgTdHp~~rlYdv~T~QcfvsanPd~qht~ai~~V~Ys~t~~lYvTaSkDG~IklwDGVS~rCv~t~~~AH~gsev 308 (430)
T KOG0640|consen 229 EFLLVGTDHPTLRLYDVNTYQCFVSANPDDQHTGAITQVRYSSTGSLYVTASKDGAIKLWDGVSNRCVRTIGNAHGGSEV 308 (430)
T ss_pred ceEEEecCCCceeEEeccceeEeeecCcccccccceeEEEecCCccEEEEeccCCcEEeeccccHHHHHHHHhhcCCcee
Confidence 99999999999999999988765442 3578899999999999999887666 999999999999888 4555 568
Q ss_pred EEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 159 QYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 159 ~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
.+..|..+|+|++++|. |..+++|.+.
T Consensus 309 cSa~Ftkn~kyiLsSG~-DS~vkLWEi~ 335 (430)
T KOG0640|consen 309 CSAVFTKNGKYILSSGK-DSTVKLWEIS 335 (430)
T ss_pred eeEEEccCCeEEeecCC-cceeeeeeec
Confidence 99999999999999888 9999999993
No 90
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=99.89 E-value=1.2e-22 Score=155.95 Aligned_cols=156 Identities=17% Similarity=0.231 Sum_probs=142.9
Q ss_pred CCCCCeEEEEee---ccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCC
Q 036605 19 EPVVSYSCLACG---FVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNG 95 (340)
Q Consensus 19 ~~~~~v~~l~~s---p~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg 95 (340)
+|+.+|..++|| |+|. +|++++.||.-.+-+-++|..+.+|.+ |.+.|...+.+.+....++++.|-
T Consensus 12 ghtrpvvdl~~s~itp~g~---------flisa~kd~~pmlr~g~tgdwigtfeg-hkgavw~~~l~~na~~aasaaadf 81 (334)
T KOG0278|consen 12 GHTRPVVDLAFSPITPDGY---------FLISASKDGKPMLRNGDTGDWIGTFEG-HKGAVWSATLNKNATRAASAAADF 81 (334)
T ss_pred CCCcceeEEeccCCCCCce---------EEEEeccCCCchhccCCCCCcEEeeec-cCcceeeeecCchhhhhhhhcccc
Confidence 899999999997 5678 999999999999999999999999999 999999999998888899999999
Q ss_pred cEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCc-eeEEeecCCCCeEEEEECCCCCEEEE
Q 036605 96 MASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGE-EVLKFSDDVGPLQYVSASDGAKIIIT 172 (340)
Q Consensus 96 ~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~-~~~~~~~~~~~v~~~~~s~~~~~l~s 172 (340)
+-++||.-+|..++.|. |+.-|.+++|+.|.++|++++.. +++||+...+ +...+.+|.+.|..+.|....+.|++
T Consensus 82 takvw~a~tgdelhsf~-hkhivk~~af~~ds~~lltgg~ekllrvfdln~p~App~E~~ghtg~Ir~v~wc~eD~~iLS 160 (334)
T KOG0278|consen 82 TAKVWDAVTGDELHSFE-HKHIVKAVAFSQDSNYLLTGGQEKLLRVFDLNRPKAPPKEISGHTGGIRTVLWCHEDKCILS 160 (334)
T ss_pred hhhhhhhhhhhhhhhhh-hhheeeeEEecccchhhhccchHHHhhhhhccCCCCCchhhcCCCCcceeEEEeccCceEEe
Confidence 99999999999998885 78889999999999999998887 9999998764 45788999999999999988889999
Q ss_pred EEcCCCeEEEEEcc
Q 036605 173 AGYGEKHLQVWRCD 186 (340)
Q Consensus 173 ~~~~d~~i~iwd~~ 186 (340)
++. |++|++||.+
T Consensus 161 Sad-d~tVRLWD~r 173 (334)
T KOG0278|consen 161 SAD-DKTVRLWDHR 173 (334)
T ss_pred ecc-CCceEEEEec
Confidence 866 9999999995
No 91
>KOG0300 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.89 E-value=1.7e-22 Score=160.33 Aligned_cols=202 Identities=13% Similarity=0.184 Sum_probs=168.2
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
+|...|+.++-..... .+.+++.|.+.+||.+++|.++.++.+ |.+.|+++.|++.+.++++++.|++-.
T Consensus 146 GHkDGiW~Vaa~~tqp---------i~gtASADhTA~iWs~Esg~CL~~Y~G-H~GSVNsikfh~s~~L~lTaSGD~taH 215 (481)
T KOG0300|consen 146 GHKDGIWHVAADSTQP---------ICGTASADHTARIWSLESGACLATYTG-HTGSVNSIKFHNSGLLLLTASGDETAH 215 (481)
T ss_pred ccccceeeehhhcCCc---------ceeecccccceeEEeeccccceeeecc-cccceeeEEeccccceEEEccCCcchH
Confidence 7888888887765555 899999999999999999999999999 999999999999999999999999999
Q ss_pred EEeC------CC----------------------------------CeEEEEeecCCCCeeEEEEccCCCEEEEe--cCc
Q 036605 99 EMKS------EM----------------------------------GEVIREFKASEKPISSSAFLCEEKIFALA--SSE 136 (340)
Q Consensus 99 ~wd~------~~----------------------------------~~~~~~~~~~~~~i~~l~~~~~~~~l~~~--~~~ 136 (340)
+|.. .. ..++..+++|...|.+..|-..|+.++++ +++
T Consensus 216 IW~~av~~~vP~~~a~~~hSsEeE~e~sDe~~~d~d~~~~sD~~tiRvPl~~ltgH~~vV~a~dWL~gg~Q~vTaSWDRT 295 (481)
T KOG0300|consen 216 IWKAAVNWEVPSNNAPSDHSSEEEEEHSDEHNRDTDSSEKSDGHTIRVPLMRLTGHRAVVSACDWLAGGQQMVTASWDRT 295 (481)
T ss_pred HHHHhhcCcCCCCCCCCCCCchhhhhcccccccccccccccCCceeeeeeeeeeccccceEehhhhcCcceeeeeecccc
Confidence 9961 11 01345678899999999999888888774 555
Q ss_pred EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCC
Q 036605 137 VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGE 216 (340)
Q Consensus 137 i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 216 (340)
..+||+++++.+..+.+|....+.++-+|..+.+++++. |.+.++||++ +.-.....+. +|...+..+ .| .
T Consensus 296 AnlwDVEtge~v~~LtGHd~ELtHcstHptQrLVvTsSr-DtTFRLWDFR-eaI~sV~VFQ---GHtdtVTS~--vF--~ 366 (481)
T KOG0300|consen 296 ANLWDVETGEVVNILTGHDSELTHCSTHPTQRLVVTSSR-DTTFRLWDFR-EAIQSVAVFQ---GHTDTVTSV--VF--N 366 (481)
T ss_pred ceeeeeccCceeccccCcchhccccccCCcceEEEEecc-CceeEeccch-hhcceeeeec---ccccceeEE--EE--e
Confidence 999999999999999999999999999999988888666 9999999996 3322233333 787777766 55 3
Q ss_pred CCCEEEEEeCCCcEEEEECCCCC
Q 036605 217 DGTVILAVAESGVAYSWDLKTVS 239 (340)
Q Consensus 217 ~~~~l~~~s~dg~i~vwd~~~~~ 239 (340)
.+..+++|+.|.+|++||++++.
T Consensus 367 ~dd~vVSgSDDrTvKvWdLrNMR 389 (481)
T KOG0300|consen 367 TDDRVVSGSDDRTVKVWDLRNMR 389 (481)
T ss_pred cCCceeecCCCceEEEeeecccc
Confidence 45679999999999999998853
No 92
>KOG0641 consensus WD40 repeat protein [General function prediction only]
Probab=99.89 E-value=7.4e-21 Score=144.20 Aligned_cols=203 Identities=16% Similarity=0.219 Sum_probs=153.2
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC------------------------------------
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT------------------------------------ 61 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~------------------------------------ 61 (340)
.||.+.|.|.+|||+|. ++|+|++|.+|++.-...
T Consensus 86 khhkgsiyc~~ws~~ge---------liatgsndk~ik~l~fn~dt~~~~g~dle~nmhdgtirdl~fld~~~s~~~il~ 156 (350)
T KOG0641|consen 86 KHHKGSIYCTAWSPCGE---------LIATGSNDKTIKVLPFNADTCNATGHDLEFNMHDGTIRDLAFLDDPESGGAILA 156 (350)
T ss_pred cccCccEEEEEecCccC---------eEEecCCCceEEEEecccccccccCcceeeeecCCceeeeEEecCCCcCceEEE
Confidence 58999999999999999 999999998888754321
Q ss_pred ----------------CeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEee----c---CCCCe
Q 036605 62 ----------------GEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFK----A---SEKPI 118 (340)
Q Consensus 62 ----------------~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~----~---~~~~i 118 (340)
|+..+.+.+ |.+.|.++- +-++-.+++|+.|.+|++||++-...+..+. . ....|
T Consensus 157 s~gagdc~iy~tdc~~g~~~~a~sg-htghilaly-swn~~m~~sgsqdktirfwdlrv~~~v~~l~~~~~~~glessav 234 (350)
T KOG0641|consen 157 SAGAGDCKIYITDCGRGQGFHALSG-HTGHILALY-SWNGAMFASGSQDKTIRFWDLRVNSCVNTLDNDFHDGGLESSAV 234 (350)
T ss_pred ecCCCcceEEEeecCCCCcceeecC-CcccEEEEE-EecCcEEEccCCCceEEEEeeeccceeeeccCcccCCCccccee
Confidence 111122233 555555442 1135677889999999999998776666542 1 23578
Q ss_pred eEEEEccCCCEEEEec--CcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCc
Q 036605 119 SSSAFLCEEKIFALAS--SEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGP 196 (340)
Q Consensus 119 ~~l~~~~~~~~l~~~~--~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~ 196 (340)
.++++.|.|++|+++- ....+||++.++.++.|..|...|.++.|+|...|+++++. |..|++-|+...-..++...
T Consensus 235 aav~vdpsgrll~sg~~dssc~lydirg~r~iq~f~phsadir~vrfsp~a~yllt~sy-d~~ikltdlqgdla~el~~~ 313 (350)
T KOG0641|consen 235 AAVAVDPSGRLLASGHADSSCMLYDIRGGRMIQRFHPHSADIRCVRFSPGAHYLLTCSY-DMKIKLTDLQGDLAHELPIM 313 (350)
T ss_pred EEEEECCCcceeeeccCCCceEEEEeeCCceeeeeCCCccceeEEEeCCCceEEEEecc-cceEEEeecccchhhcCceE
Confidence 9999999999999954 44999999999999999999999999999999999999988 99999999832111222222
Q ss_pred eeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECC
Q 036605 197 ALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 197 ~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
.--+|....+.+ -| +|....+++.+.|.++.+|-+.
T Consensus 314 -vv~ehkdk~i~~--rw-h~~d~sfisssadkt~tlwa~~ 349 (350)
T KOG0641|consen 314 -VVAEHKDKAIQC--RW-HPQDFSFISSSADKTATLWALN 349 (350)
T ss_pred -EEEeccCceEEE--Ee-cCccceeeeccCcceEEEeccC
Confidence 222566666655 77 7888889999999999999764
No 93
>KOG0308 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.89 E-value=1.2e-22 Score=174.70 Aligned_cols=201 Identities=13% Similarity=0.134 Sum_probs=167.0
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe--eEEEecCCCCCCeEEEEE-ecCCCEEEEEeCCC
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE--MKWKSTGRHPGGLAGLAF-AKKGRSLHVVGTNG 95 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~--~~~~~~~~h~~~v~~v~~-~~~~~~l~s~~~dg 95 (340)
+|...|..++...+++ .|++++.|-+|.+|+...+. +...+.. |...|.|++. .++...+++||-|+
T Consensus 71 ~HsDWVNDiiL~~~~~---------tlIS~SsDtTVK~W~~~~~~~~c~stir~-H~DYVkcla~~ak~~~lvaSgGLD~ 140 (735)
T KOG0308|consen 71 HHSDWVNDIILCGNGK---------TLISASSDTTVKVWNAHKDNTFCMSTIRT-HKDYVKCLAYIAKNNELVASGGLDR 140 (735)
T ss_pred hhHhHHhhHHhhcCCC---------ceEEecCCceEEEeecccCcchhHhhhhc-ccchheeeeecccCceeEEecCCCc
Confidence 7888888888888887 79999999999999988773 4455566 9999999999 77888999999999
Q ss_pred cEEEEeCCCCe--EEEE--------ee-cCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEE
Q 036605 96 MASEMKSEMGE--VIRE--------FK-ASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVS 162 (340)
Q Consensus 96 ~i~~wd~~~~~--~~~~--------~~-~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~ 162 (340)
.|.+||+.++. .+.. +. ++..+|++++.++.|..+++|+-. +++||.++.+.+.++.+|...|..+.
T Consensus 141 ~IflWDin~~~~~l~~s~n~~t~~sl~sG~k~siYSLA~N~t~t~ivsGgtek~lr~wDprt~~kimkLrGHTdNVr~ll 220 (735)
T KOG0308|consen 141 KIFLWDINTGTATLVASFNNVTVNSLGSGPKDSIYSLAMNQTGTIIVSGGTEKDLRLWDPRTCKKIMKLRGHTDNVRVLL 220 (735)
T ss_pred cEEEEEccCcchhhhhhccccccccCCCCCccceeeeecCCcceEEEecCcccceEEeccccccceeeeeccccceEEEE
Confidence 99999999873 2222 22 677889999999999777776655 99999999999999999999999999
Q ss_pred ECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 163 ASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 163 ~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
.++||..++++++ ||+|++||++ ....+..+. .|...++.+ .. +++-.++++|+.||.|+.=|+.+.
T Consensus 221 ~~dDGt~~ls~sS-DgtIrlWdLg--qQrCl~T~~---vH~e~VWaL--~~-~~sf~~vYsG~rd~~i~~Tdl~n~ 287 (735)
T KOG0308|consen 221 VNDDGTRLLSASS-DGTIRLWDLG--QQRCLATYI---VHKEGVWAL--QS-SPSFTHVYSGGRDGNIYRTDLRNP 287 (735)
T ss_pred EcCCCCeEeecCC-CceEEeeecc--ccceeeeEE---eccCceEEE--ee-CCCcceEEecCCCCcEEecccCCc
Confidence 9999999999888 9999999993 333333333 455555555 33 577889999999999999999883
No 94
>KOG1446 consensus Histone H3 (Lys4) methyltransferase complex and RNA cleavage factor II complex, subunit SWD2 [RNA processing and modification; Chromatin structure and dynamics; Posttranslational modification, protein turnover, chaperones]
Probab=99.89 E-value=5.4e-20 Score=146.04 Aligned_cols=207 Identities=14% Similarity=0.091 Sum_probs=165.9
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeC--CCcE
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGT--NGMA 97 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~--dg~i 97 (340)
....|+++.|+++|. +|++++.|.+|++||..+++.++++.. +.-.+..++|......++.++. |..|
T Consensus 13 ~~~~i~sl~fs~~G~---------~litss~dDsl~LYd~~~g~~~~ti~s-kkyG~~~~~Fth~~~~~i~sStk~d~tI 82 (311)
T KOG1446|consen 13 TNGKINSLDFSDDGL---------LLITSSEDDSLRLYDSLSGKQVKTINS-KKYGVDLACFTHHSNTVIHSSTKEDDTI 82 (311)
T ss_pred CCCceeEEEecCCCC---------EEEEecCCCeEEEEEcCCCceeeEeec-ccccccEEEEecCCceEEEccCCCCCce
Confidence 457899999999999 899999999999999999999998887 6668888999877777776665 8899
Q ss_pred EEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEc
Q 036605 98 SEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGY 175 (340)
Q Consensus 98 ~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~ 175 (340)
+..++.+.+.++.|.+|...|.+|+.+|-+..+++++.+ |++||++..++...+..... ..++|+|+|-+++++..
T Consensus 83 ryLsl~dNkylRYF~GH~~~V~sL~~sP~~d~FlS~S~D~tvrLWDlR~~~cqg~l~~~~~--pi~AfDp~GLifA~~~~ 160 (311)
T KOG1446|consen 83 RYLSLHDNKYLRYFPGHKKRVNSLSVSPKDDTFLSSSLDKTVRLWDLRVKKCQGLLNLSGR--PIAAFDPEGLIFALANG 160 (311)
T ss_pred EEEEeecCceEEEcCCCCceEEEEEecCCCCeEEecccCCeEEeeEecCCCCceEEecCCC--cceeECCCCcEEEEecC
Confidence 999999999999999999999999999999888886554 99999998776655543333 35799999988887655
Q ss_pred CCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 176 GEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 176 ~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
...|++||+|.-.+.....+.+..........+ -| +++|++++..+..+.+++.|.-.+..+.
T Consensus 161 -~~~IkLyD~Rs~dkgPF~tf~i~~~~~~ew~~l--~F-S~dGK~iLlsT~~s~~~~lDAf~G~~~~ 223 (311)
T KOG1446|consen 161 -SELIKLYDLRSFDKGPFTTFSITDNDEAEWTDL--EF-SPDGKSILLSTNASFIYLLDAFDGTVKS 223 (311)
T ss_pred -CCeEEEEEecccCCCCceeEccCCCCccceeee--EE-cCCCCEEEEEeCCCcEEEEEccCCcEee
Confidence 559999999755444444444332222233333 44 8999999999999999999998876544
No 95
>KOG0267 consensus Microtubule severing protein katanin p80 subunit B (contains WD40 repeats) [Cell cycle control, cell division, chromosome partitioning]
Probab=99.89 E-value=1.5e-23 Score=182.33 Aligned_cols=191 Identities=15% Similarity=0.186 Sum_probs=161.3
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
+|+.+|.|+.|+++.. +|++|+.+|+|++||++.++.++++.+ |...+..+.|+|-+.+.++++.|+.++
T Consensus 68 ~hespIeSl~f~~~E~---------LlaagsasgtiK~wDleeAk~vrtLtg-h~~~~~sv~f~P~~~~~a~gStdtd~~ 137 (825)
T KOG0267|consen 68 GHESPIESLTFDTSER---------LLAAGSASGTIKVWDLEEAKIVRTLTG-HLLNITSVDFHPYGEFFASGSTDTDLK 137 (825)
T ss_pred ccCCcceeeecCcchh---------hhcccccCCceeeeehhhhhhhhhhhc-cccCcceeeeccceEEeccccccccce
Confidence 8999999999999999 999999999999999999999999998 999999999999999999999999999
Q ss_pred EEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcC
Q 036605 99 EMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYG 176 (340)
Q Consensus 99 ~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~ 176 (340)
+||++...+...+.+|...+..+.|+|+|++++.++.+ ++|||+..|+.+..|..|.+.+..+.|+|..-.+.+++.
T Consensus 138 iwD~Rk~Gc~~~~~s~~~vv~~l~lsP~Gr~v~~g~ed~tvki~d~~agk~~~ef~~~e~~v~sle~hp~e~Lla~Gs~- 216 (825)
T KOG0267|consen 138 IWDIRKKGCSHTYKSHTRVVDVLRLSPDGRWVASGGEDNTVKIWDLTAGKLSKEFKSHEGKVQSLEFHPLEVLLAPGSS- 216 (825)
T ss_pred ehhhhccCceeeecCCcceeEEEeecCCCceeeccCCcceeeeecccccccccccccccccccccccCchhhhhccCCC-
Confidence 99999777888899999999999999999999997664 999999999999999999999999999998866666555
Q ss_pred CCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCC
Q 036605 177 EKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESG 228 (340)
Q Consensus 177 d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg 228 (340)
|+++++||+ .+-+.+.... .....+... .| .+++..+++|....
T Consensus 217 d~tv~f~dl--etfe~I~s~~---~~~~~v~~~--~f-n~~~~~~~~G~q~s 260 (825)
T KOG0267|consen 217 DRTVRFWDL--ETFEVISSGK---PETDGVRSL--AF-NPDGKIVLSGEQIS 260 (825)
T ss_pred Cceeeeecc--ceeEEeeccC---CccCCceee--ee-cCCceeeecCchhh
Confidence 999999998 3322222111 111122222 34 78888777776554
No 96
>KOG0288 consensus WD40 repeat protein TipD [General function prediction only]
Probab=99.89 E-value=1.2e-22 Score=165.96 Aligned_cols=207 Identities=11% Similarity=0.102 Sum_probs=170.4
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
+||..++++..++. +|...|+++.|..... .+++|+.|.+|++||+....+..++. ....+.+|+
T Consensus 245 ~Wnvd~~r~~~TLs----GHtdkVt~ak~~~~~~---------~vVsgs~DRtiK~WDl~k~~C~kt~l--~~S~cnDI~ 309 (459)
T KOG0288|consen 245 LWNVDSLRLRHTLS----GHTDKVTAAKFKLSHS---------RVVSGSADRTIKLWDLQKAYCSKTVL--PGSQCNDIV 309 (459)
T ss_pred eeeccchhhhhhhc----ccccceeeehhhcccc---------ceeeccccchhhhhhhhhhheecccc--ccccccceE
Confidence 69999999999998 8999999999987765 59999999999999999988776665 334566676
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecC----
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDD---- 154 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~---- 154 (340)
.+ +..++++-.|+.|+.||+++.........+. .|+++..++++..+.+.+.+ +.++|+++......|...
T Consensus 310 ~~--~~~~~SgH~DkkvRfwD~Rs~~~~~sv~~gg-~vtSl~ls~~g~~lLsssRDdtl~viDlRt~eI~~~~sA~g~k~ 386 (459)
T KOG0288|consen 310 CS--ISDVISGHFDKKVRFWDIRSADKTRSVPLGG-RVTSLDLSMDGLELLSSSRDDTLKVIDLRTKEIRQTFSAEGFKC 386 (459)
T ss_pred ec--ceeeeecccccceEEEeccCCceeeEeecCc-ceeeEeeccCCeEEeeecCCCceeeeecccccEEEEeecccccc
Confidence 65 5678899999999999999999888887655 89999999999999887666 999999999877776442
Q ss_pred CCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCC-eeeeeecCCCCCCCCEEEEEeCCCcEEEE
Q 036605 155 VGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSP-VAIDCKNSPNGEDGTVILAVAESGVAYSW 233 (340)
Q Consensus 155 ~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~l~~~s~dg~i~vw 233 (340)
....+.+.|||++.|+++|+. ||.|+||++ .+++....... .+.+ .+..+ .| .+.|..+++++.++.+.+|
T Consensus 387 asDwtrvvfSpd~~YvaAGS~-dgsv~iW~v--~tgKlE~~l~~--s~s~~aI~s~--~W-~~sG~~Llsadk~~~v~lW 458 (459)
T KOG0288|consen 387 ASDWTRVVFSPDGSYVAAGSA-DGSVYIWSV--FTGKLEKVLSL--STSNAAITSL--SW-NPSGSGLLSADKQKAVTLW 458 (459)
T ss_pred ccccceeEECCCCceeeeccC-CCcEEEEEc--cCceEEEEecc--CCCCcceEEE--EE-cCCCchhhcccCCcceEec
Confidence 245789999999999999888 999999999 45544333332 2222 45555 77 8899999999999999999
No 97
>KOG2096 consensus WD40 repeat protein [General function prediction only]
Probab=99.89 E-value=4.7e-21 Score=152.11 Aligned_cols=211 Identities=12% Similarity=0.130 Sum_probs=156.6
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe-----------------------------------
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE----------------------------------- 63 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~----------------------------------- 63 (340)
+|...|+|++|+.||+ +||+++.|++|++|++..-.
T Consensus 84 gH~~~vt~~~FsSdGK---------~lat~~~Dr~Ir~w~~~DF~~~eHr~~R~nve~dhpT~V~FapDc~s~vv~~~~g 154 (420)
T KOG2096|consen 84 GHKKEVTDVAFSSDGK---------KLATISGDRSIRLWDVRDFENKEHRCIRQNVEYDHPTRVVFAPDCKSVVVSVKRG 154 (420)
T ss_pred ccCCceeeeEEcCCCc---------eeEEEeCCceEEEEecchhhhhhhhHhhccccCCCceEEEECCCcceEEEEEccC
Confidence 7999999999999999 99999999999999975321
Q ss_pred -eEEEe----------------------cCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeE
Q 036605 64 -MKWKS----------------------TGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISS 120 (340)
Q Consensus 64 -~~~~~----------------------~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~ 120 (340)
.++.+ ...|+..|..+-....+.+|++++.|..|.+|++. |+.+..+......-+.
T Consensus 155 ~~l~vyk~~K~~dG~~~~~~v~~D~~~f~~kh~v~~i~iGiA~~~k~imsas~dt~i~lw~lk-Gq~L~~idtnq~~n~~ 233 (420)
T KOG2096|consen 155 NKLCVYKLVKKTDGSGSHHFVHIDNLEFERKHQVDIINIGIAGNAKYIMSASLDTKICLWDLK-GQLLQSIDTNQSSNYD 233 (420)
T ss_pred CEEEEEEeeecccCCCCcccccccccccchhcccceEEEeecCCceEEEEecCCCcEEEEecC-Cceeeeeccccccccc
Confidence 01100 01133445555555567789999999999999998 8888888877777888
Q ss_pred EEEccCCCEEEEecCc--EEEEECC---CC-----ceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCC-
Q 036605 121 SAFLCEEKIFALASSE--VRILSLE---NG-----EEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISS- 189 (340)
Q Consensus 121 l~~~~~~~~l~~~~~~--i~i~d~~---~~-----~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~- 189 (340)
.+++|+|+++++++-+ |++|..- .| ..+..+.+|...|..++|+++...+++.+. ||.++|||.+..-
T Consensus 234 aavSP~GRFia~~gFTpDVkVwE~~f~kdG~fqev~rvf~LkGH~saV~~~aFsn~S~r~vtvSk-DG~wriwdtdVrY~ 312 (420)
T KOG2096|consen 234 AAVSPDGRFIAVSGFTPDVKVWEPIFTKDGTFQEVKRVFSLKGHQSAVLAAAFSNSSTRAVTVSK-DGKWRIWDTDVRYE 312 (420)
T ss_pred eeeCCCCcEEEEecCCCCceEEEEEeccCcchhhhhhhheeccchhheeeeeeCCCcceeEEEec-CCcEEEeeccceEe
Confidence 9999999999998776 9999863 22 234677999999999999999999999888 9999999985321
Q ss_pred -CCc---cCCcee---eecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCC
Q 036605 190 -KTV---NKGPAL---SMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 190 -~~~---~~~~~~---~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p 246 (340)
++- +..... .-+..+.-..+ +|+|..|+... ...+.+|..++++..+.++-
T Consensus 313 ~~qDpk~Lk~g~~pl~aag~~p~RL~l-----sP~g~~lA~s~-gs~l~~~~se~g~~~~~~e~ 370 (420)
T KOG2096|consen 313 AGQDPKILKEGSAPLHAAGSEPVRLEL-----SPSGDSLAVSF-GSDLKVFASEDGKDYPELED 370 (420)
T ss_pred cCCCchHhhcCCcchhhcCCCceEEEe-----CCCCcEEEeec-CCceEEEEcccCccchhHHH
Confidence 111 111110 11223333444 88988777655 45699999999877775554
No 98
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.89 E-value=1.1e-21 Score=162.45 Aligned_cols=204 Identities=19% Similarity=0.217 Sum_probs=163.1
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeE-EEe---------------c-CCCCCCeEEEEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMK-WKS---------------T-GRHPGGLAGLAF 81 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~-~~~---------------~-~~h~~~v~~v~~ 81 (340)
.|..+|+|++++|+++ +.++++.+|+|.-|++.+|+.. ..+ . ..|...|.+++.
T Consensus 140 ~H~~s~~~vals~d~~---------~~fsask~g~i~kw~v~tgk~~~~i~~~~ev~k~~~~~~k~~r~~h~keil~~av 210 (479)
T KOG0299|consen 140 KHQLSVTSVALSPDDK---------RVFSASKDGTILKWDVLTGKKDRYIIERDEVLKSHGNPLKESRKGHVKEILTLAV 210 (479)
T ss_pred cccCcceEEEeecccc---------ceeecCCCcceeeeehhcCcccccccccchhhhhccCCCCcccccccceeEEEEE
Confidence 6889999999999999 8999999999999999888633 111 1 138889999999
Q ss_pred ecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE--ecCcEEEEECCCCceeEEeecCCCCeE
Q 036605 82 AKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL--ASSEVRILSLENGEEVLKFSDDVGPLQ 159 (340)
Q Consensus 82 ~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~--~~~~i~i~d~~~~~~~~~~~~~~~~v~ 159 (340)
++||++|++|+.|..|.+|+.++.+.+..|++|.+.|.+++|-.....+++ .++.+++|++.....+.++-+|...|.
T Consensus 211 S~Dgkylatgg~d~~v~Iw~~~t~ehv~~~~ghr~~V~~L~fr~gt~~lys~s~Drsvkvw~~~~~s~vetlyGHqd~v~ 290 (479)
T KOG0299|consen 211 SSDGKYLATGGRDRHVQIWDCDTLEHVKVFKGHRGAVSSLAFRKGTSELYSASADRSVKVWSIDQLSYVETLYGHQDGVL 290 (479)
T ss_pred cCCCcEEEecCCCceEEEecCcccchhhcccccccceeeeeeecCccceeeeecCCceEEEehhHhHHHHHHhCCcccee
Confidence 999999999999999999999999999999999999999999876555554 566699999998888888999999999
Q ss_pred EEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCC
Q 036605 160 YVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVS 239 (340)
Q Consensus 160 ~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~ 239 (340)
.+....-++.+-+++. |+++++|++...++. .+. ++... +++. ++ -+...+++|+.+|.|.+|++...+
T Consensus 291 ~IdaL~reR~vtVGgr-DrT~rlwKi~eesql---ifr---g~~~s-idcv-~~--In~~HfvsGSdnG~IaLWs~~KKk 359 (479)
T KOG0299|consen 291 GIDALSRERCVTVGGR-DRTVRLWKIPEESQL---IFR---GGEGS-IDCV-AF--INDEHFVSGSDNGSIALWSLLKKK 359 (479)
T ss_pred eechhcccceEEeccc-cceeEEEecccccee---eee---CCCCC-eeeE-EE--ecccceeeccCCceEEEeeecccC
Confidence 9988877766666556 999999999322211 111 33222 2331 33 345679999999999999998766
Q ss_pred ccC
Q 036605 240 QDE 242 (340)
Q Consensus 240 ~~~ 242 (340)
.+.
T Consensus 360 plf 362 (479)
T KOG0299|consen 360 PLF 362 (479)
T ss_pred cee
Confidence 554
No 99
>KOG0288 consensus WD40 repeat protein TipD [General function prediction only]
Probab=99.89 E-value=2.3e-22 Score=164.41 Aligned_cols=216 Identities=9% Similarity=0.110 Sum_probs=165.7
Q ss_pred CccCCCCc--eeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEE
Q 036605 1 IWSTNDGS--LLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAG 78 (340)
Q Consensus 1 vwd~~~g~--~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~ 78 (340)
+|+...+. +...+. +-.+.++.+.|.++++ ++++++.|+.+++|++...+...++.+ |++.|++
T Consensus 201 ~W~v~~~k~~~~~tLa----Gs~g~it~~d~d~~~~---------~~iAas~d~~~r~Wnvd~~r~~~TLsG-HtdkVt~ 266 (459)
T KOG0288|consen 201 LWNVLGEKSELISTLA----GSLGNITSIDFDSDNK---------HVIAASNDKNLRLWNVDSLRLRHTLSG-HTDKVTA 266 (459)
T ss_pred hhhcccchhhhhhhhh----ccCCCcceeeecCCCc---------eEEeecCCCceeeeeccchhhhhhhcc-cccceee
Confidence 47765554 334444 5667899999999998 899999999999999999999999999 9999999
Q ss_pred EEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEe--cCcEEEEECCCCceeEEeecCCC
Q 036605 79 LAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALA--SSEVRILSLENGEEVLKFSDDVG 156 (340)
Q Consensus 79 v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~--~~~i~i~d~~~~~~~~~~~~~~~ 156 (340)
+.|......+++|+.|.+|+.||+..+....++-. ...+..|..+ ...++++ +..|++||.++.........+.
T Consensus 267 ak~~~~~~~vVsgs~DRtiK~WDl~k~~C~kt~l~-~S~cnDI~~~--~~~~~SgH~DkkvRfwD~Rs~~~~~sv~~gg- 342 (459)
T KOG0288|consen 267 AKFKLSHSRVVSGSADRTIKLWDLQKAYCSKTVLP-GSQCNDIVCS--ISDVISGHFDKKVRFWDIRSADKTRSVPLGG- 342 (459)
T ss_pred ehhhccccceeeccccchhhhhhhhhhheeccccc-cccccceEec--ceeeeecccccceEEEeccCCceeeEeecCc-
Confidence 99988777799999999999999998776655432 2234455554 3334443 4449999999998888887665
Q ss_pred CeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCcee---eecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEE
Q 036605 157 PLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPAL---SMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSW 233 (340)
Q Consensus 157 ~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~---~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vw 233 (340)
.|+++..++++..+++++. |.++.+.|++ +.+....+.. ...+. ...+ .| +|++.|+++||.||.|+||
T Consensus 343 ~vtSl~ls~~g~~lLsssR-Ddtl~viDlR--t~eI~~~~sA~g~k~asD--wtrv--vf-Spd~~YvaAGS~dgsv~iW 414 (459)
T KOG0288|consen 343 RVTSLDLSMDGLELLSSSR-DDTLKVIDLR--TKEIRQTFSAEGFKCASD--WTRV--VF-SPDGSYVAAGSADGSVYIW 414 (459)
T ss_pred ceeeEeeccCCeEEeeecC-CCceeeeecc--cccEEEEeeccccccccc--ccee--EE-CCCCceeeeccCCCcEEEE
Confidence 8999999999999999876 9999999995 3332222211 11111 1111 34 8999999999999999999
Q ss_pred ECCCCCccC
Q 036605 234 DLKTVSQDE 242 (340)
Q Consensus 234 d~~~~~~~~ 242 (340)
++.+++...
T Consensus 415 ~v~tgKlE~ 423 (459)
T KOG0288|consen 415 SVFTGKLEK 423 (459)
T ss_pred EccCceEEE
Confidence 999877655
No 100
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.89 E-value=1.1e-21 Score=150.10 Aligned_cols=210 Identities=15% Similarity=0.185 Sum_probs=161.2
Q ss_pred ceeeeeeCCCCCCCCCeEEEEeec--cccccccccCceEEEEEcCCCcEEEEEccCCee--EEEecCCCCCCeEEEEEec
Q 036605 8 SLLAEWKQPDGEPVVSYSCLACGF--VGKKRRKERGTLLLALGTSNGDILAVDVLTGEM--KWKSTGRHPGGLAGLAFAK 83 (340)
Q Consensus 8 ~~~~~~~~~~~~~~~~v~~l~~sp--~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~--~~~~~~~h~~~v~~v~~~~ 83 (340)
.++.+++ +|.++|..++|.. -|. +||+++.||.|.||.-++|+. ...... |.+.|++++|.|
T Consensus 47 ~ll~~L~----Gh~GPVwqv~wahPk~G~---------iLAScsYDgkVIiWke~~g~w~k~~e~~~-h~~SVNsV~wap 112 (299)
T KOG1332|consen 47 KLLAELT----GHSGPVWKVAWAHPKFGT---------ILASCSYDGKVIIWKEENGRWTKAYEHAA-HSASVNSVAWAP 112 (299)
T ss_pred eeeeEec----CCCCCeeEEeecccccCc---------EeeEeecCceEEEEecCCCchhhhhhhhh-hcccceeecccc
Confidence 4567777 9999999999965 457 999999999999999888853 233444 999999999999
Q ss_pred C--CCEEEEEeCCCcEEEEeCCCC---eEEEEeecCCCCeeEEEEccC---C-----------CEEEEecCc--EEEEEC
Q 036605 84 K--GRSLHVVGTNGMASEMKSEMG---EVIREFKASEKPISSSAFLCE---E-----------KIFALASSE--VRILSL 142 (340)
Q Consensus 84 ~--~~~l~s~~~dg~i~~wd~~~~---~~~~~~~~~~~~i~~l~~~~~---~-----------~~l~~~~~~--i~i~d~ 142 (340)
. |-.|++++.||.|.+++.++. .......+|.-.+++++|.|. | +.|++++.+ |+||+.
T Consensus 113 heygl~LacasSDG~vsvl~~~~~g~w~t~ki~~aH~~GvnsVswapa~~~g~~~~~~~~~~~krlvSgGcDn~VkiW~~ 192 (299)
T KOG1332|consen 113 HEYGLLLACASSDGKVSVLTYDSSGGWTTSKIVFAHEIGVNSVSWAPASAPGSLVDQGPAAKVKRLVSGGCDNLVKIWKF 192 (299)
T ss_pred cccceEEEEeeCCCcEEEEEEcCCCCccchhhhhccccccceeeecCcCCCccccccCcccccceeeccCCccceeeeec
Confidence 6 457899999999999988754 122346688999999999986 4 457776655 999999
Q ss_pred CCCce--eEEeecCCCCeEEEEECCCC----CEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCC
Q 036605 143 ENGEE--VLKFSDDVGPLQYVSASDGA----KIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGE 216 (340)
Q Consensus 143 ~~~~~--~~~~~~~~~~v~~~~~s~~~----~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 216 (340)
.++.- ...+.+|...|+.++|.|.- .+|++++. ||++.||..+.+..+....+. ...+..+..+ +| +.
T Consensus 193 ~~~~w~~e~~l~~H~dwVRDVAwaP~~gl~~s~iAS~Sq-Dg~viIwt~~~e~e~wk~tll--~~f~~~~w~v--SW-S~ 266 (299)
T KOG1332|consen 193 DSDSWKLERTLEGHKDWVRDVAWAPSVGLPKSTIASCSQ-DGTVIIWTKDEEYEPWKKTLL--EEFPDVVWRV--SW-SL 266 (299)
T ss_pred CCcchhhhhhhhhcchhhhhhhhccccCCCceeeEEecC-CCcEEEEEecCccCccccccc--ccCCcceEEE--EE-ec
Confidence 88632 35589999999999999873 46788777 999999998522222222221 1344555555 67 88
Q ss_pred CCCEEEEEeCCCcEEEEECCC
Q 036605 217 DGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 217 ~~~~l~~~s~dg~i~vwd~~~ 237 (340)
.|..|+.++.|+.|.+|.-..
T Consensus 267 sGn~LaVs~GdNkvtlwke~~ 287 (299)
T KOG1332|consen 267 SGNILAVSGGDNKVTLWKENV 287 (299)
T ss_pred cccEEEEecCCcEEEEEEeCC
Confidence 999999999999999997543
No 101
>KOG0268 consensus Sof1-like rRNA processing protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.89 E-value=2.2e-22 Score=162.03 Aligned_cols=209 Identities=18% Similarity=0.245 Sum_probs=157.5
Q ss_pred CCCCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCc
Q 036605 18 GEPVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGM 96 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~ 96 (340)
.+|...|.|++=+|.. . .+|+|+.||.|+|||+....+.+++.. |.+.|.+|++.. ..+++++.|.+
T Consensus 63 ~gHrdGV~~lakhp~~ls---------~~aSGs~DG~VkiWnlsqR~~~~~f~A-H~G~V~Gi~v~~--~~~~tvgdDKt 130 (433)
T KOG0268|consen 63 DGHRDGVSCLAKHPNKLS---------TVASGSCDGEVKIWNLSQRECIRTFKA-HEGLVRGICVTQ--TSFFTVGDDKT 130 (433)
T ss_pred cccccccchhhcCcchhh---------hhhccccCceEEEEehhhhhhhheeec-ccCceeeEEecc--cceEEecCCcc
Confidence 4899999999999988 6 799999999999999999999999998 999999999985 67888999998
Q ss_pred EEEEeCCC---------------------------Ce-----------EEEEeecCCCCeeEEEEccCCCEE-EEe--cC
Q 036605 97 ASEMKSEM---------------------------GE-----------VIREFKASEKPISSSAFLCEEKIF-ALA--SS 135 (340)
Q Consensus 97 i~~wd~~~---------------------------~~-----------~~~~~~~~~~~i~~l~~~~~~~~l-~~~--~~ 135 (340)
|+.|.+.. |+ ++..+......|.++.|+|-...+ +++ ++
T Consensus 131 vK~wk~~~~p~~tilg~s~~~gIdh~~~~~~FaTcGe~i~IWD~~R~~Pv~smswG~Dti~svkfNpvETsILas~~sDr 210 (433)
T KOG0268|consen 131 VKQWKIDGPPLHTILGKSVYLGIDHHRKNSVFATCGEQIDIWDEQRDNPVSSMSWGADSISSVKFNPVETSILASCASDR 210 (433)
T ss_pred eeeeeccCCcceeeeccccccccccccccccccccCceeeecccccCCccceeecCCCceeEEecCCCcchheeeeccCC
Confidence 88887321 11 223333344557788888876554 444 33
Q ss_pred cEEEEECCCCceeEEe------------------------------------------ecCCCCeEEEEECCCCCEEEEE
Q 036605 136 EVRILSLENGEEVLKF------------------------------------------SDDVGPLQYVSASDGAKIIITA 173 (340)
Q Consensus 136 ~i~i~d~~~~~~~~~~------------------------------------------~~~~~~v~~~~~s~~~~~l~s~ 173 (340)
.|.+||++++.++.++ .+|.+.|.++.|+|.|+-|+++
T Consensus 211 sIvLyD~R~~~Pl~KVi~~mRTN~IswnPeafnF~~a~ED~nlY~~DmR~l~~p~~v~~dhvsAV~dVdfsptG~Efvsg 290 (433)
T KOG0268|consen 211 SIVLYDLRQASPLKKVILTMRTNTICWNPEAFNFVAANEDHNLYTYDMRNLSRPLNVHKDHVSAVMDVDFSPTGQEFVSG 290 (433)
T ss_pred ceEEEecccCCccceeeeeccccceecCccccceeeccccccceehhhhhhcccchhhcccceeEEEeccCCCcchhccc
Confidence 4999999877655332 3567789999999999999998
Q ss_pred EcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCC
Q 036605 174 GYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 174 ~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p 246 (340)
+. |.+|+||..+ .+.. . -.........++.+ .| +.|..++++||.|+.|++|.....+.+..+.|
T Consensus 291 sy-DksIRIf~~~--~~~S-R-diYhtkRMq~V~~V--k~-S~Dskyi~SGSdd~nvRlWka~Aseklgv~t~ 355 (433)
T KOG0268|consen 291 SY-DKSIRIFPVN--HGHS-R-DIYHTKRMQHVFCV--KY-SMDSKYIISGSDDGNVRLWKAKASEKLGVITP 355 (433)
T ss_pred cc-cceEEEeecC--CCcc-h-hhhhHhhhheeeEE--EE-eccccEEEecCCCcceeeeecchhhhcCCCCh
Confidence 88 9999999984 2111 1 11000122234444 45 88999999999999999999988777764554
No 102
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=99.88 E-value=5.5e-22 Score=166.55 Aligned_cols=204 Identities=12% Similarity=0.053 Sum_probs=148.1
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEE-Ee----cCCCCCCeEEEEEecCCCEEEEEe
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKW-KS----TGRHPGGLAGLAFAKKGRSLHVVG 92 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~-~~----~~~h~~~v~~v~~~~~~~~l~s~~ 92 (340)
.+|...++|.+|+|+.+ ..+++++.||+++|||+.+.+... .+ .++..-.++.++|++||+++++|+
T Consensus 265 KGHia~lt~g~whP~~k--------~~FlT~s~DgtlRiWdv~~~k~q~qVik~k~~~g~Rv~~tsC~~nrdg~~iAagc 336 (641)
T KOG0772|consen 265 KGHIAELTCGCWHPDNK--------EEFLTCSYDGTLRIWDVNNTKSQLQVIKTKPAGGKRVPVTSCAWNRDGKLIAAGC 336 (641)
T ss_pred CCceeeeeccccccCcc--------cceEEecCCCcEEEEecCCchhheeEEeeccCCCcccCceeeecCCCcchhhhcc
Confidence 47999999999999984 179999999999999998765222 22 222334679999999999999999
Q ss_pred CCCcEEEEeCCCCeE--E-EEeecCCC--CeeEEEEccCCCEEEEec--CcEEEEECCCCc-eeEEeecC--CCCeEEEE
Q 036605 93 TNGMASEMKSEMGEV--I-REFKASEK--PISSSAFLCEEKIFALAS--SEVRILSLENGE-EVLKFSDD--VGPLQYVS 162 (340)
Q Consensus 93 ~dg~i~~wd~~~~~~--~-~~~~~~~~--~i~~l~~~~~~~~l~~~~--~~i~i~d~~~~~-~~~~~~~~--~~~v~~~~ 162 (340)
.||.|.+|+...... . ..-++|.. .|+||.||++|++|++-+ +.+++||++..+ ++..+.+- ..+-+.++
T Consensus 337 ~DGSIQ~W~~~~~~v~p~~~vk~AH~~g~~Itsi~FS~dg~~LlSRg~D~tLKvWDLrq~kkpL~~~tgL~t~~~~tdc~ 416 (641)
T KOG0772|consen 337 LDGSIQIWDKGSRTVRPVMKVKDAHLPGQDITSISFSYDGNYLLSRGFDDTLKVWDLRQFKKPLNVRTGLPTPFPGTDCC 416 (641)
T ss_pred cCCceeeeecCCcccccceEeeeccCCCCceeEEEeccccchhhhccCCCceeeeeccccccchhhhcCCCccCCCCccc
Confidence 999999999754322 1 22345655 899999999999999944 449999998754 44444333 35668899
Q ss_pred ECCCCCEEEEEEcC-----CCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 163 ASDGAKIIITAGYG-----EKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 163 ~s~~~~~l~s~~~~-----d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
|||+.+.|++|.+. .+.+.+||- .+-+....+.+ . ...+. .|.| +|.-+.|++|+.||.+++|--.+
T Consensus 417 FSPd~kli~TGtS~~~~~~~g~L~f~d~--~t~d~v~ki~i--~-~aSvv--~~~W-hpkLNQi~~gsgdG~~~vyYdp~ 488 (641)
T KOG0772|consen 417 FSPDDKLILTGTSAPNGMTAGTLFFFDR--MTLDTVYKIDI--S-TASVV--RCLW-HPKLNQIFAGSGDGTAHVYYDPN 488 (641)
T ss_pred cCCCceEEEecccccCCCCCceEEEEec--cceeeEEEecC--C-CceEE--EEee-cchhhheeeecCCCceEEEECcc
Confidence 99999999986542 467889986 23222222221 1 22233 3477 88888999999999999984433
No 103
>KOG1407 consensus WD40 repeat protein [Function unknown]
Probab=99.88 E-value=1e-20 Score=146.25 Aligned_cols=210 Identities=12% Similarity=0.116 Sum_probs=173.2
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
+||..++++..... ....-.-+.|+|+|. ++++|..|..|.+.|..+.+.....+ ..-.++-++
T Consensus 91 ~wd~r~~k~~~~i~-----~~~eni~i~wsp~g~---------~~~~~~kdD~it~id~r~~~~~~~~~--~~~e~ne~~ 154 (313)
T KOG1407|consen 91 IWDIRSGKCTARIE-----TKGENINITWSPDGE---------YIAVGNKDDRITFIDARTYKIVNEEQ--FKFEVNEIS 154 (313)
T ss_pred EEEeccCcEEEEee-----ccCcceEEEEcCCCC---------EEEEecCcccEEEEEecccceeehhc--ccceeeeee
Confidence 58888888777665 223444688999999 99999999999999999887776655 556788999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCe
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPL 158 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v 158 (340)
|+-++..++.....|.|.+.....-+++..+++|.....||.|+|+|+++|+|+.+ +.+||+...-+++.|.-+..+|
T Consensus 155 w~~~nd~Fflt~GlG~v~ILsypsLkpv~si~AH~snCicI~f~p~GryfA~GsADAlvSLWD~~ELiC~R~isRldwpV 234 (313)
T KOG1407|consen 155 WNNSNDLFFLTNGLGCVEILSYPSLKPVQSIKAHPSNCICIEFDPDGRYFATGSADALVSLWDVDELICERCISRLDWPV 234 (313)
T ss_pred ecCCCCEEEEecCCceEEEEeccccccccccccCCcceEEEEECCCCceEeeccccceeeccChhHhhhheeeccccCce
Confidence 99878777777777999999999999999999999999999999999999997777 9999999988889999999999
Q ss_pred EEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCC---------Cc
Q 036605 159 QYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAES---------GV 229 (340)
Q Consensus 159 ~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~d---------g~ 229 (340)
+.+.|+.||++|++++. |..|-|=++ +++.....+ .+....+.+ .| +|...+|+-++.| |.
T Consensus 235 RTlSFS~dg~~lASaSE-Dh~IDIA~v--etGd~~~eI----~~~~~t~tV--AW-HPk~~LLAyA~ddk~~d~~reag~ 304 (313)
T KOG1407|consen 235 RTLSFSHDGRMLASASE-DHFIDIAEV--ETGDRVWEI----PCEGPTFTV--AW-HPKRPLLAYACDDKDGDSNREAGT 304 (313)
T ss_pred EEEEeccCcceeeccCc-cceEEeEec--ccCCeEEEe----eccCCceeE--Ee-cCCCceeeEEecCCCCccccccce
Confidence 99999999999999877 999999888 566554333 344455555 77 8888888877765 56
Q ss_pred EEEEECC
Q 036605 230 AYSWDLK 236 (340)
Q Consensus 230 i~vwd~~ 236 (340)
+++|-+.
T Consensus 305 vKiFG~~ 311 (313)
T KOG1407|consen 305 VKIFGLS 311 (313)
T ss_pred eEEecCC
Confidence 6666543
No 104
>KOG0321 consensus WD40 repeat-containing protein L2DTL [Function unknown]
Probab=99.88 E-value=8.5e-21 Score=163.21 Aligned_cols=251 Identities=15% Similarity=0.140 Sum_probs=177.4
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEE--ecCCCCCCeEEEEEecCC-CEEEEEeCCC
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWK--STGRHPGGLAGLAFAKKG-RSLHVVGTNG 95 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~--~~~~h~~~v~~v~~~~~~-~~l~s~~~dg 95 (340)
.|...|..+.|.|... .|++++.|.++++||++++++... +.+ |.+.|.++||.|.. ..+++|+.||
T Consensus 98 aH~nAifDl~wapge~---------~lVsasGDsT~r~Wdvk~s~l~G~~~~~G-H~~SvkS~cf~~~n~~vF~tGgRDg 167 (720)
T KOG0321|consen 98 AHKNAIFDLKWAPGES---------LLVSASGDSTIRPWDVKTSRLVGGRLNLG-HTGSVKSECFMPTNPAVFCTGGRDG 167 (720)
T ss_pred cccceeEeeccCCCce---------eEEEccCCceeeeeeeccceeecceeecc-cccccchhhhccCCCcceeeccCCC
Confidence 7899999999999446 899999999999999999987765 666 99999999999965 4788999999
Q ss_pred cEEEEeCCCCe---------------------------EEEEeecCCCCeeE---EEEccCCCEEEEecC---cEEEEEC
Q 036605 96 MASEMKSEMGE---------------------------VIREFKASEKPISS---SAFLCEEKIFALASS---EVRILSL 142 (340)
Q Consensus 96 ~i~~wd~~~~~---------------------------~~~~~~~~~~~i~~---l~~~~~~~~l~~~~~---~i~i~d~ 142 (340)
.|.+||++-.. .+...+++...|.+ +.+..|...|++++. .|++||+
T Consensus 168 ~illWD~R~n~~d~~e~~~~~~~~~~n~~ptpskp~~kr~~k~kA~s~ti~ssvTvv~fkDe~tlaSaga~D~~iKVWDL 247 (720)
T KOG0321|consen 168 EILLWDCRCNGVDALEEFDNRIYGRHNTAPTPSKPLKKRIRKWKAASNTIFSSVTVVLFKDESTLASAGAADSTIKVWDL 247 (720)
T ss_pred cEEEEEEeccchhhHHHHhhhhhccccCCCCCCchhhccccccccccCceeeeeEEEEEeccceeeeccCCCcceEEEee
Confidence 99999986321 11223345555655 667788888888444 4999999
Q ss_pred CCCceeE--------EeecC---CCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeec
Q 036605 143 ENGEEVL--------KFSDD---VGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKN 211 (340)
Q Consensus 143 ~~~~~~~--------~~~~~---~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~ 211 (340)
+...... .+..| ...+.++.....|.+|++.+. |+.|+.|++..........+. ++....+.+..
T Consensus 248 Rk~~~~~r~ep~~~~~~~t~skrs~G~~nL~lDssGt~L~AsCt-D~sIy~ynm~s~s~sP~~~~s---g~~~~sf~vks 323 (720)
T KOG0321|consen 248 RKNYTAYRQEPRGSDKYPTHSKRSVGQVNLILDSSGTYLFASCT-DNSIYFYNMRSLSISPVAEFS---GKLNSSFYVKS 323 (720)
T ss_pred cccccccccCCCcccCccCcccceeeeEEEEecCCCCeEEEEec-CCcEEEEeccccCcCchhhcc---Ccccceeeeee
Confidence 8764332 22223 245677788888999999888 999999999533332222222 44444444444
Q ss_pred CCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCC-ceEEEeecccccccccccccccccceeeeeecccccCCCeEEEe
Q 036605 212 SPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNP-AKITVKLKKADADQQNSVNVKKSRTSIIAARLNDLEADGQKTIT 290 (340)
Q Consensus 212 ~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p-~~i~~~~~~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~ 290 (340)
.. ++++.++++|+.|+..++|.+.+.+.-..+.- +.+.+.... .......++++. ..|..+.++
T Consensus 324 ~l-Spd~~~l~SgSsd~~ayiw~vs~~e~~~~~l~Ght~eVt~V~---------w~pS~~t~v~Tc-----SdD~~~kiW 388 (720)
T KOG0321|consen 324 EL-SPDDCSLLSGSSDEQAYIWVVSSPEAPPALLLGHTREVTTVR---------WLPSATTPVATC-----SDDFRVKIW 388 (720)
T ss_pred ec-CCCCceEeccCCCcceeeeeecCccCChhhhhCcceEEEEEe---------eccccCCCceee-----ccCcceEEE
Confidence 44 89999999999999999999998776654443 444444322 112223344444 378889999
Q ss_pred cCCc-chhh
Q 036605 291 GLHD-LESE 298 (340)
Q Consensus 291 ~~~~-~e~e 298 (340)
...+ ++..
T Consensus 389 ~l~~~l~e~ 397 (720)
T KOG0321|consen 389 RLSNGLEEI 397 (720)
T ss_pred eccCchhhc
Confidence 7766 4433
No 105
>KOG0264 consensus Nucleosome remodeling factor, subunit CAF1/NURF55/MSI1 [Chromatin structure and dynamics]
Probab=99.88 E-value=3.2e-21 Score=159.58 Aligned_cols=204 Identities=13% Similarity=0.120 Sum_probs=160.0
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe----------eEEEecCCCCCCeEEEEEecCC-CE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE----------MKWKSTGRHPGGLAGLAFAKKG-RS 87 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~----------~~~~~~~~h~~~v~~v~~~~~~-~~ 87 (340)
.|.+.|+.+..-|... .++|+++..+.|+|||..+-. ...++.+ |.+.-++++|++.. ..
T Consensus 122 ~h~gEVnRaRymPQnp--------~iVAt~t~~~dv~Vfd~tk~~s~~~~~~~~~Pdl~L~g-H~~eg~glsWn~~~~g~ 192 (422)
T KOG0264|consen 122 NHDGEVNRARYMPQNP--------NIVATKTSSGDVYVFDYTKHPSKPKASGECRPDLRLKG-HEKEGYGLSWNRQQEGT 192 (422)
T ss_pred cCCccchhhhhCCCCC--------cEEEecCCCCCEEEEEeccCCCcccccccCCCceEEEe-eccccccccccccccee
Confidence 5778888888888773 288899999999999976532 1225677 88878899999854 47
Q ss_pred EEEEeCCCcEEEEeCCCCe-------EEEEeecCCCCeeEEEEccCCCEE-EEec--CcEEEEECCC--CceeEEeecCC
Q 036605 88 LHVVGTNGMASEMKSEMGE-------VIREFKASEKPISSSAFLCEEKIF-ALAS--SEVRILSLEN--GEEVLKFSDDV 155 (340)
Q Consensus 88 l~s~~~dg~i~~wd~~~~~-------~~~~~~~~~~~i~~l~~~~~~~~l-~~~~--~~i~i~d~~~--~~~~~~~~~~~ 155 (340)
|++++.|+.|++||+.... +...+.+|...|..++|++-...+ ++++ +.+.|||+++ .+......+|.
T Consensus 193 Lls~~~d~~i~lwdi~~~~~~~~~~~p~~~~~~h~~~VeDV~~h~~h~~lF~sv~dd~~L~iwD~R~~~~~~~~~~~ah~ 272 (422)
T KOG0264|consen 193 LLSGSDDHTICLWDINAESKEDKVVDPKTIFSGHEDVVEDVAWHPLHEDLFGSVGDDGKLMIWDTRSNTSKPSHSVKAHS 272 (422)
T ss_pred EeeccCCCcEEEEeccccccCCccccceEEeecCCcceehhhccccchhhheeecCCCeEEEEEcCCCCCCCcccccccC
Confidence 9999999999999987543 345588999999999999976555 3333 3399999994 45556678999
Q ss_pred CCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEEC
Q 036605 156 GPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDL 235 (340)
Q Consensus 156 ~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~ 235 (340)
+.+.+++|+|-+.+++++++.|++|.+||+| +-......+. +|...++.+ .|.......|++++.|+.+.|||+
T Consensus 273 ~~vn~~~fnp~~~~ilAT~S~D~tV~LwDlR-nL~~~lh~~e---~H~dev~~V--~WSPh~etvLASSg~D~rl~vWDl 346 (422)
T KOG0264|consen 273 AEVNCVAFNPFNEFILATGSADKTVALWDLR-NLNKPLHTFE---GHEDEVFQV--EWSPHNETVLASSGTDRRLNVWDL 346 (422)
T ss_pred CceeEEEeCCCCCceEEeccCCCcEEEeech-hcccCceecc---CCCcceEEE--EeCCCCCceeEecccCCcEEEEec
Confidence 9999999999887777767779999999997 3333333444 888889888 775456678899999999999999
Q ss_pred CC
Q 036605 236 KT 237 (340)
Q Consensus 236 ~~ 237 (340)
..
T Consensus 347 s~ 348 (422)
T KOG0264|consen 347 SR 348 (422)
T ss_pred cc
Confidence 87
No 106
>KOG0301 consensus Phospholipase A2-activating protein (contains WD40 repeats) [Lipid transport and metabolism]
Probab=99.88 E-value=3.1e-21 Score=167.33 Aligned_cols=203 Identities=16% Similarity=0.270 Sum_probs=162.5
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
||.+..+..++.++ +|...|.|++-..++. +++|+.|.++++|- .+++...+.+ |+..|.+++
T Consensus 85 v~~~~~~~P~~~Lk----gH~snVC~ls~~~~~~----------~iSgSWD~TakvW~--~~~l~~~l~g-H~asVWAv~ 147 (745)
T KOG0301|consen 85 VFKLSQAEPLYTLK----GHKSNVCSLSIGEDGT----------LISGSWDSTAKVWR--IGELVYSLQG-HTASVWAVA 147 (745)
T ss_pred EEecCCCCchhhhh----ccccceeeeecCCcCc----------eEecccccceEEec--chhhhcccCC-cchheeeee
Confidence 35566666677777 8999999998877666 99999999999997 4556667888 999999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE-ecCcEEEEECCCCceeEEeecCCCCeE
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL-ASSEVRILSLENGEEVLKFSDDVGPLQ 159 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~-~~~~i~i~d~~~~~~~~~~~~~~~~v~ 159 (340)
+-|++ .++||+.|..|++|.- ++.+..|.+|...|..+++-+++.++-+ -++.|++|++ +|+.+..+.+|...+.
T Consensus 148 ~l~e~-~~vTgsaDKtIklWk~--~~~l~tf~gHtD~VRgL~vl~~~~flScsNDg~Ir~w~~-~ge~l~~~~ghtn~vY 223 (745)
T KOG0301|consen 148 SLPEN-TYVTGSADKTIKLWKG--GTLLKTFSGHTDCVRGLAVLDDSHFLSCSNDGSIRLWDL-DGEVLLEMHGHTNFVY 223 (745)
T ss_pred ecCCC-cEEeccCcceeeeccC--CchhhhhccchhheeeeEEecCCCeEeecCCceEEEEec-cCceeeeeeccceEEE
Confidence 99977 8999999999999975 7788899999999999999998766633 3444999999 7789999999999999
Q ss_pred EEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCC-eeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 160 YVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSP-VAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 160 ~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
++....++..++++|. |++++||+.. +... .+.++. .++++. ++ ++|. +++|++||.||||....
T Consensus 224 sis~~~~~~~Ivs~gE-DrtlriW~~~----e~~q----~I~lPttsiWsa~-~L--~NgD-Ivvg~SDG~VrVfT~~k 289 (745)
T KOG0301|consen 224 SISMALSDGLIVSTGE-DRTLRIWKKD----ECVQ----VITLPTTSIWSAK-VL--LNGD-IVVGGSDGRVRVFTVDK 289 (745)
T ss_pred EEEecCCCCeEEEecC-CceEEEeecC----ceEE----EEecCccceEEEE-Ee--eCCC-EEEeccCceEEEEEecc
Confidence 9998788889999898 9999999962 2211 224444 233331 22 3333 78899999999998764
No 107
>KOG4547 consensus WD40 repeat-containing protein [General function prediction only]
Probab=99.88 E-value=2.9e-20 Score=158.98 Aligned_cols=239 Identities=21% Similarity=0.295 Sum_probs=195.1
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeec--ccc---------ccccccCceEEEEEcCCCcEEEEEccCCeeEEEec
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGF--VGK---------KRRKERGTLLLALGTSNGDILAVDVLTGEMKWKST 69 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp--~~~---------~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~ 69 (340)
|||+..+++..+|.|. .+.++.++++.|.- +.+ ..++...+.+++.|...|.|.+|++..|+..+++.
T Consensus 19 iw~t~~~~~~~e~~p~-~~~s~t~~~~~w~L~~~~s~~k~~~~~~~~~~s~~t~~lvlgt~~g~v~~ys~~~g~it~~~s 97 (541)
T KOG4547|consen 19 IWDTAKNQLQQEFAPI-ASLSGTCTYTKWGLSADYSPMKWLSLEKAKKASLDTSMLVLGTPQGSVLLYSVAGGEITAKLS 97 (541)
T ss_pred EEEccCceeeeeeccc-hhccCcceeEEEEEEeccchHHHHhHHHHhhccCCceEEEeecCCccEEEEEecCCeEEEEEe
Confidence 6999999999999988 57788999999941 111 11234477899999999999999999999998887
Q ss_pred -CCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCcEEEEECCCCcee
Q 036605 70 -GRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSEVRILSLENGEEV 148 (340)
Q Consensus 70 -~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~i~i~d~~~~~~~ 148 (340)
+.|.+.|+++.++.+-..|++++.|+.+..|+...+..++.++..+..+.+++++||+..+++++++|++||+++++.+
T Consensus 98 t~~h~~~v~~~~~~~~~~ciyS~~ad~~v~~~~~~~~~~~~~~~~~~~~~~sl~is~D~~~l~~as~~ik~~~~~~kevv 177 (541)
T KOG4547|consen 98 TDKHYGNVNEILDAQRLGCIYSVGADLKVVYILEKEKVIIRIWKEQKPLVSSLCISPDGKILLTASRQIKVLDIETKEVV 177 (541)
T ss_pred cCCCCCcceeeecccccCceEecCCceeEEEEecccceeeeeeccCCCccceEEEcCCCCEEEeccceEEEEEccCceEE
Confidence 5799999999999888999999999999999999999999999999999999999999999999999999999999999
Q ss_pred EEeecCCCCeEEEEECCC-----CCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEE
Q 036605 149 LKFSDDVGPLQYVSASDG-----AKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILA 223 (340)
Q Consensus 149 ~~~~~~~~~v~~~~~s~~-----~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~ 223 (340)
..|.+|.++|+++.|..+ |.|++++...+..+.+|-++...++......+.+.+.+...+........++-.+++
T Consensus 178 ~~ftgh~s~v~t~~f~~~~~g~~G~~vLssa~~~r~i~~w~v~~~~kkks~~~sl~~~dipv~~ds~~~ed~~~~l~lAs 257 (541)
T KOG4547|consen 178 ITFTGHGSPVRTLSFTTLIDGIIGKYVLSSAAAERGITVWVVEKEDKKKSLSCSLTVPDIPVTSDSGLLEDGTIPLVLAS 257 (541)
T ss_pred EEecCCCcceEEEEEEEeccccccceeeeccccccceeEEEEEcccccchhheeeccCCCCeEeccccccccccceEEee
Confidence 999999999999999766 889999888788999999875566666777777788777766532221122233444
Q ss_pred EeCCCcEEEEECCCCCcc
Q 036605 224 VAESGVAYSWDLKTVSQD 241 (340)
Q Consensus 224 ~s~dg~i~vwd~~~~~~~ 241 (340)
...+| +..|...+...+
T Consensus 258 t~~~g-~v~~~~~nl~~l 274 (541)
T KOG4547|consen 258 TLIPG-IVHLKLSNLIIL 274 (541)
T ss_pred eccCc-eeeeccccHHHH
Confidence 44455 555555553333
No 108
>KOG0302 consensus Ribosome Assembly protein [General function prediction only]
Probab=99.88 E-value=6.1e-21 Score=154.53 Aligned_cols=205 Identities=16% Similarity=0.186 Sum_probs=150.9
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeE---EEecCCCCCCeEEEEEecCC-CEEEEEeCC
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMK---WKSTGRHPGGLAGLAFAKKG-RSLHVVGTN 94 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~---~~~~~~h~~~v~~v~~~~~~-~~l~s~~~d 94 (340)
+|...=..|+|||-.. ..|++|..-+.|++|...+|... ..+.+ |...|-.++|+|.. ..|++|+.|
T Consensus 209 ghk~EGy~LdWSp~~~--------g~LlsGDc~~~I~lw~~~~g~W~vd~~Pf~g-H~~SVEDLqWSptE~~vfaScS~D 279 (440)
T KOG0302|consen 209 GHKGEGYGLDWSPIKT--------GRLLSGDCVKGIHLWEPSTGSWKVDQRPFTG-HTKSVEDLQWSPTEDGVFASCSCD 279 (440)
T ss_pred ccCccceeeecccccc--------cccccCccccceEeeeeccCceeecCccccc-cccchhhhccCCccCceEEeeecC
Confidence 7778888999999542 14999999999999999988643 24555 99999999999954 589999999
Q ss_pred CcEEEEeCCCCeE--EEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCC---CceeEEeecCCCCeEEEEECCCC
Q 036605 95 GMASEMKSEMGEV--IREFKASEKPISSSAFLCEEKIFALASSE--VRILSLEN---GEEVLKFSDDVGPLQYVSASDGA 167 (340)
Q Consensus 95 g~i~~wd~~~~~~--~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~---~~~~~~~~~~~~~v~~~~~s~~~ 167 (340)
|+|++||++.+.. ....++|.+.|..|.|+....+|++++.+ ++|||++. ++++..|+-|..+|+++.|+|..
T Consensus 280 gsIrIWDiRs~~~~~~~~~kAh~sDVNVISWnr~~~lLasG~DdGt~~iwDLR~~~~~~pVA~fk~Hk~pItsieW~p~e 359 (440)
T KOG0302|consen 280 GSIRIWDIRSGPKKAAVSTKAHNSDVNVISWNRREPLLASGGDDGTLSIWDLRQFKSGQPVATFKYHKAPITSIEWHPHE 359 (440)
T ss_pred ceEEEEEecCCCccceeEeeccCCceeeEEccCCcceeeecCCCceEEEEEhhhccCCCcceeEEeccCCeeEEEecccc
Confidence 9999999998832 22347899999999999998888887665 99999975 56778999999999999999875
Q ss_pred CEEEEEEcCCCeEEEEEccCCCCCc------cCC-----ceeeecC--CCeeeeeecCCCCCCCCEEEEEeCCCcEEEEE
Q 036605 168 KIIITAGYGEKHLQVWRCDISSKTV------NKG-----PALSMRH--SPVAIDCKNSPNGEDGTVILAVAESGVAYSWD 234 (340)
Q Consensus 168 ~~l~s~~~~d~~i~iwd~~~~~~~~------~~~-----~~~~~~~--~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd 234 (340)
..++.++..|.+|.|||+....... ... ..+-+-| ...+..+ .|......++++.+.|| +.||.
T Consensus 360 ~s~iaasg~D~QitiWDlsvE~D~ee~~~~a~~~L~dlPpQLLFVHqGQke~Kev--hWH~QiPG~lvsTa~dG-fnVfk 436 (440)
T KOG0302|consen 360 DSVIAASGEDNQITIWDLSVEADEEEIDQEAAEGLQDLPPQLLFVHQGQKEVKEV--HWHRQIPGLLVSTAIDG-FNVFK 436 (440)
T ss_pred CceEEeccCCCcEEEEEeeccCChhhhccccccchhcCCceeEEEecchhHhhhh--eeccCCCCeEEEecccc-eeEEE
Confidence 5444444449999999995433200 000 1111112 1122233 44344566888888999 77765
Q ss_pred C
Q 036605 235 L 235 (340)
Q Consensus 235 ~ 235 (340)
.
T Consensus 437 t 437 (440)
T KOG0302|consen 437 T 437 (440)
T ss_pred e
Confidence 3
No 109
>KOG4283 consensus Transcription-coupled repair protein CSA, contains WD40 domain [Transcription; Replication, recombination and repair]
Probab=99.88 E-value=8.9e-21 Score=149.04 Aligned_cols=210 Identities=12% Similarity=0.130 Sum_probs=163.8
Q ss_pred CCCCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCe----------eEEEe----cCCCCCCeEEEEEe
Q 036605 18 GEPVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGE----------MKWKS----TGRHPGGLAGLAFA 82 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~----------~~~~~----~~~h~~~v~~v~~~ 82 (340)
..|.+.|..|...+.. + |+++|+.||.|.+||+++.. .++.+ ...|.-.|..+.|-
T Consensus 40 r~HgGsvNsL~id~tegr---------ymlSGgadgsi~v~Dl~n~t~~e~s~li~k~~c~v~~~h~~~Hky~iss~~Wy 110 (397)
T KOG4283|consen 40 RPHGGSVNSLQIDLTEGR---------YMLSGGADGSIAVFDLQNATDYEASGLIAKHKCIVAKQHENGHKYAISSAIWY 110 (397)
T ss_pred ccCCCccceeeeccccce---------EEeecCCCccEEEEEeccccchhhccceeheeeeccccCCccceeeeeeeEEe
Confidence 3577889999988765 7 99999999999999997643 11111 22477889999999
Q ss_pred c-CCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccC---CCEEEEecCc--EEEEECCCCceeEEeecCCC
Q 036605 83 K-KGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCE---EKIFALASSE--VRILSLENGEEVLKFSDDVG 156 (340)
Q Consensus 83 ~-~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~---~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~ 156 (340)
| |...+.+++.|.++++||..+.+....|+. ++.|++-+++|- ..+++++.++ |++-|+.+|.....+.+|..
T Consensus 111 P~DtGmFtssSFDhtlKVWDtnTlQ~a~~F~m-e~~VYshamSp~a~sHcLiA~gtr~~~VrLCDi~SGs~sH~LsGHr~ 189 (397)
T KOG4283|consen 111 PIDTGMFTSSSFDHTLKVWDTNTLQEAVDFKM-EGKVYSHAMSPMAMSHCLIAAGTRDVQVRLCDIASGSFSHTLSGHRD 189 (397)
T ss_pred eecCceeecccccceEEEeecccceeeEEeec-CceeehhhcChhhhcceEEEEecCCCcEEEEeccCCcceeeeccccC
Confidence 9 555778889999999999999888877764 556788788874 3345555444 99999999999999999999
Q ss_pred CeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCC----------CccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeC
Q 036605 157 PLQYVSASDGAKIIITAGYGEKHLQVWRCDISSK----------TVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAE 226 (340)
Q Consensus 157 ~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~----------~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~ 226 (340)
.|.++.|+|...+++..+..||.|++||+|..++ +..........|...+..+ +| ..++.++++.+.
T Consensus 190 ~vlaV~Wsp~~e~vLatgsaDg~irlWDiRrasgcf~~lD~hn~k~~p~~~~n~ah~gkvngl--a~-tSd~~~l~~~gt 266 (397)
T KOG4283|consen 190 GVLAVEWSPSSEWVLATGSADGAIRLWDIRRASGCFRVLDQHNTKRPPILKTNTAHYGKVNGL--AW-TSDARYLASCGT 266 (397)
T ss_pred ceEEEEeccCceeEEEecCCCceEEEEEeecccceeEEeecccCccCccccccccccceeeee--ee-cccchhhhhccC
Confidence 9999999999999888888899999999975432 1111222223455566666 77 789999999999
Q ss_pred CCcEEEEECCCCCc
Q 036605 227 SGVAYSWDLKTVSQ 240 (340)
Q Consensus 227 dg~i~vwd~~~~~~ 240 (340)
|.++++|+..+++.
T Consensus 267 d~r~r~wn~~~G~n 280 (397)
T KOG4283|consen 267 DDRIRVWNMESGRN 280 (397)
T ss_pred ccceEEeecccCcc
Confidence 99999999988654
No 110
>KOG1539 consensus WD repeat protein [General function prediction only]
Probab=99.87 E-value=1.5e-20 Score=166.31 Aligned_cols=198 Identities=17% Similarity=0.308 Sum_probs=165.6
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEec--CCCCCCeEEEEEecCCCEEEEEeCCCcE
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKST--GRHPGGLAGLAFAKKGRSLHVVGTNGMA 97 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~--~~h~~~v~~v~~~~~~~~l~s~~~dg~i 97 (340)
....++|++.++.|. +.+.|+..|+|-+||+++|-...++. ..|.++|++++...-++.+++++.+|.+
T Consensus 447 ~~~~~~av~vs~CGN---------F~~IG~S~G~Id~fNmQSGi~r~sf~~~~ah~~~V~gla~D~~n~~~vsa~~~Gil 517 (910)
T KOG1539|consen 447 DDINATAVCVSFCGN---------FVFIGYSKGTIDRFNMQSGIHRKSFGDSPAHKGEVTGLAVDGTNRLLVSAGADGIL 517 (910)
T ss_pred cCcceEEEEEeccCc---------eEEEeccCCeEEEEEcccCeeecccccCccccCceeEEEecCCCceEEEccCcceE
Confidence 347899999999999 99999999999999999998777773 2499999999999888999999999999
Q ss_pred EEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEc
Q 036605 98 SEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGY 175 (340)
Q Consensus 98 ~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~ 175 (340)
.+||......+..+.. ..++.++..+.....++.+-.+ |+++|..+.+.++.|.+|...|+++.|||||++|++++.
T Consensus 518 kfw~f~~k~l~~~l~l-~~~~~~iv~hr~s~l~a~~~ddf~I~vvD~~t~kvvR~f~gh~nritd~~FS~DgrWlisasm 596 (910)
T KOG1539|consen 518 KFWDFKKKVLKKSLRL-GSSITGIVYHRVSDLLAIALDDFSIRVVDVVTRKVVREFWGHGNRITDMTFSPDGRWLISASM 596 (910)
T ss_pred EEEecCCcceeeeecc-CCCcceeeeeehhhhhhhhcCceeEEEEEchhhhhhHHhhccccceeeeEeCCCCcEEEEeec
Confidence 9999998887777764 4567788888777777664444 999999999999999999999999999999999999888
Q ss_pred CCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCC-CcEEEEECCC
Q 036605 176 GEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAES-GVAYSWDLKT 237 (340)
Q Consensus 176 ~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~d-g~i~vwd~~~ 237 (340)
|++|++||+ .++..+..+. +..+...+.+ +|+|.+|++...| .-|++|.-..
T Consensus 597 -D~tIr~wDl--pt~~lID~~~--vd~~~~sls~-----SPngD~LAT~Hvd~~gIylWsNks 649 (910)
T KOG1539|consen 597 -DSTIRTWDL--PTGTLIDGLL--VDSPCTSLSF-----SPNGDFLATVHVDQNGIYLWSNKS 649 (910)
T ss_pred -CCcEEEEec--cCcceeeeEe--cCCcceeeEE-----CCCCCEEEEEEecCceEEEEEchh
Confidence 999999999 5655544333 2344444444 9999999999998 4599996544
No 111
>KOG1273 consensus WD40 repeat protein [General function prediction only]
Probab=99.87 E-value=1.1e-20 Score=149.74 Aligned_cols=210 Identities=16% Similarity=0.191 Sum_probs=153.6
Q ss_pred eEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCC
Q 036605 24 YSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSE 103 (340)
Q Consensus 24 v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~ 103 (340)
..|+.|++.|. +||+|+.||.|.|||+.+......+.+ |..+|.+++|++||+.|++++.|..|.+||+.
T Consensus 26 a~~~~Fs~~G~---------~lAvGc~nG~vvI~D~~T~~iar~lsa-H~~pi~sl~WS~dgr~LltsS~D~si~lwDl~ 95 (405)
T KOG1273|consen 26 AECCQFSRWGD---------YLAVGCANGRVVIYDFDTFRIARMLSA-HVRPITSLCWSRDGRKLLTSSRDWSIKLWDLL 95 (405)
T ss_pred cceEEeccCcc---------eeeeeccCCcEEEEEccccchhhhhhc-cccceeEEEecCCCCEeeeecCCceeEEEecc
Confidence 68999999999 999999999999999999887777777 99999999999999999999999999999999
Q ss_pred CCeEEEEeecCCCCee-----------------------------------------------EEEEccCCCEEEEecCc
Q 036605 104 MGEVIREFKASEKPIS-----------------------------------------------SSAFLCEEKIFALASSE 136 (340)
Q Consensus 104 ~~~~~~~~~~~~~~i~-----------------------------------------------~l~~~~~~~~l~~~~~~ 136 (340)
.|.+++.+.. .++|. +..|.+.|+++++|...
T Consensus 96 ~gs~l~rirf-~spv~~~q~hp~k~n~~va~~~~~sp~vi~~s~~~h~~Lp~d~d~dln~sas~~~fdr~g~yIitGtsK 174 (405)
T KOG1273|consen 96 KGSPLKRIRF-DSPVWGAQWHPRKRNKCVATIMEESPVVIDFSDPKHSVLPKDDDGDLNSSASHGVFDRRGKYIITGTSK 174 (405)
T ss_pred CCCceeEEEc-cCccceeeeccccCCeEEEEEecCCcEEEEecCCceeeccCCCccccccccccccccCCCCEEEEecCc
Confidence 8876655321 11111 11244567788776554
Q ss_pred --EEEEECCCCceeEEeecCC-CCeEEEEECCCCCEEEEEEcCCCeEEEEEccC-CCCCccCCceeeecCCCeee--e-e
Q 036605 137 --VRILSLENGEEVLKFSDDV-GPLQYVSASDGAKIIITAGYGEKHLQVWRCDI-SSKTVNKGPALSMRHSPVAI--D-C 209 (340)
Q Consensus 137 --i~i~d~~~~~~~~~~~~~~-~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~-~~~~~~~~~~~~~~~~~~~~--~-~ 209 (340)
+.+||..+.+.+..++... ..|..+.|+-.|++|+.-.. |+.|+.|++.. .....-..+.........+. . -
T Consensus 175 Gkllv~~a~t~e~vas~rits~~~IK~I~~s~~g~~liiNts-DRvIR~ye~~di~~~~r~~e~e~~~K~qDvVNk~~Wk 253 (405)
T KOG1273|consen 175 GKLLVYDAETLECVASFRITSVQAIKQIIVSRKGRFLIINTS-DRVIRTYEISDIDDEGRDGEVEPEHKLQDVVNKLQWK 253 (405)
T ss_pred ceEEEEecchheeeeeeeechheeeeEEEEeccCcEEEEecC-CceEEEEehhhhcccCccCCcChhHHHHHHHhhhhhh
Confidence 9999999998888886555 78999999999999999777 99999999841 11100000000000001111 1 1
Q ss_pred ecCCCCCCCCEEEEEeCC-CcEEEEECCCCCccCCCCC
Q 036605 210 KNSPNGEDGTVILAVAES-GVAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 210 ~~~~~~~~~~~l~~~s~d-g~i~vwd~~~~~~~~~~~p 246 (340)
.|+| +.+|.|+++++.. ..++||.-..+..+..+..
T Consensus 254 ~ccf-s~dgeYv~a~s~~aHaLYIWE~~~GsLVKILhG 290 (405)
T KOG1273|consen 254 KCCF-SGDGEYVCAGSARAHALYIWEKSIGSLVKILHG 290 (405)
T ss_pred heee-cCCccEEEeccccceeEEEEecCCcceeeeecC
Confidence 2355 7799999887753 5699999888777664433
No 112
>KOG4328 consensus WD40 protein [Function unknown]
Probab=99.87 E-value=2.4e-20 Score=154.60 Aligned_cols=206 Identities=13% Similarity=0.111 Sum_probs=158.2
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe----eEEEecCCCCCCeEEEEEecC-CCEEEEEeC
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE----MKWKSTGRHPGGLAGLAFAKK-GRSLHVVGT 93 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~----~~~~~~~~h~~~v~~v~~~~~-~~~l~s~~~ 93 (340)
-+..+|+|++|+|... ..++|+|...|.|-+||+.+.+ -+..+.. |.++|.++.|+|. ...+++.+.
T Consensus 184 v~~~Rit~l~fHPt~~-------~~lva~GdK~G~VG~Wn~~~~~~d~d~v~~f~~-hs~~Vs~l~F~P~n~s~i~ssSy 255 (498)
T KOG4328|consen 184 VTDRRITSLAFHPTEN-------RKLVAVGDKGGQVGLWNFGTQEKDKDGVYLFTP-HSGPVSGLKFSPANTSQIYSSSY 255 (498)
T ss_pred ecccceEEEEecccCc-------ceEEEEccCCCcEEEEecCCCCCccCceEEecc-CCccccceEecCCChhheeeecc
Confidence 5678999999999873 1299999999999999995221 3445566 9999999999994 458999999
Q ss_pred CCcEEEEeCCCCeEEEE--eecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCce-eEEeecCCCCeEEEEECCCCC
Q 036605 94 NGMASEMKSEMGEVIRE--FKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEE-VLKFSDDVGPLQYVSASDGAK 168 (340)
Q Consensus 94 dg~i~~wd~~~~~~~~~--~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~-~~~~~~~~~~v~~~~~s~~~~ 168 (340)
||+|+.-|++.+..... .......++.+.|+.+...++.++.- +.+||++++.. ...+..|...|.+++++|-..
T Consensus 256 DGtiR~~D~~~~i~e~v~s~~~d~~~fs~~d~~~e~~~vl~~~~~G~f~~iD~R~~~s~~~~~~lh~kKI~sv~~NP~~p 335 (498)
T KOG4328|consen 256 DGTIRLQDFEGNISEEVLSLDTDNIWFSSLDFSAESRSVLFGDNVGNFNVIDLRTDGSEYENLRLHKKKITSVALNPVCP 335 (498)
T ss_pred CceeeeeeecchhhHHHhhcCccceeeeeccccCCCccEEEeecccceEEEEeecCCccchhhhhhhcccceeecCCCCc
Confidence 99999999987643222 32245567888888888777775543 89999998765 566678888999999999887
Q ss_pred EEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECC
Q 036605 169 IIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 169 ~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
++++++..|++.+|||+|.-.++.. .+...+.|...+.+. +| +|.+..|++.+.|..|+|||..
T Consensus 336 ~~laT~s~D~T~kIWD~R~l~~K~s-p~lst~~HrrsV~sA--yF-SPs~gtl~TT~~D~~IRv~dss 399 (498)
T KOG4328|consen 336 WFLATASLDQTAKIWDLRQLRGKAS-PFLSTLPHRRSVNSA--YF-SPSGGTLLTTCQDNEIRVFDSS 399 (498)
T ss_pred hheeecccCcceeeeehhhhcCCCC-cceecccccceeeee--EE-cCCCCceEeeccCCceEEeecc
Confidence 6655555599999999974443332 244455676666665 66 7888889999999999999984
No 113
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=99.87 E-value=2.4e-20 Score=147.45 Aligned_cols=225 Identities=14% Similarity=0.105 Sum_probs=159.6
Q ss_pred ccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEE
Q 036605 2 WSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAF 81 (340)
Q Consensus 2 wd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~ 81 (340)
||....++...++ |..++.+++|.++.+ +++|+.||.|+.+|+.++... .+.. |..+|.||.+
T Consensus 40 Ydv~~~~l~~~~~-----~~~plL~c~F~d~~~----------~~~G~~dg~vr~~Dln~~~~~-~igt-h~~~i~ci~~ 102 (323)
T KOG1036|consen 40 YDVPANSLKLKFK-----HGAPLLDCAFADEST----------IVTGGLDGQVRRYDLNTGNED-QIGT-HDEGIRCIEY 102 (323)
T ss_pred Eeccchhhhhhee-----cCCceeeeeccCCce----------EEEeccCceEEEEEecCCcce-eecc-CCCceEEEEe
Confidence 3444444444454 889999999998666 999999999999999998754 3333 9999999999
Q ss_pred ecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCcEEEEECCCCceeEEe--ecCCCCeE
Q 036605 82 AKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSEVRILSLENGEEVLKF--SDDVGPLQ 159 (340)
Q Consensus 82 ~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~i~i~d~~~~~~~~~~--~~~~~~v~ 159 (340)
++....+++|+.|++|++||.+.......+.. ...|.++....+--.+.+.++.+.+||+++....... ..-...++
T Consensus 103 ~~~~~~vIsgsWD~~ik~wD~R~~~~~~~~d~-~kkVy~~~v~g~~LvVg~~~r~v~iyDLRn~~~~~q~reS~lkyqtR 181 (323)
T KOG1036|consen 103 SYEVGCVISGSWDKTIKFWDPRNKVVVGTFDQ-GKKVYCMDVSGNRLVVGTSDRKVLIYDLRNLDEPFQRRESSLKYQTR 181 (323)
T ss_pred eccCCeEEEcccCccEEEEecccccccccccc-CceEEEEeccCCEEEEeecCceEEEEEcccccchhhhccccceeEEE
Confidence 99888999999999999999987555544543 3378888877543333356666999999987654322 23346789
Q ss_pred EEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeee-----cCCCeeeeeec-CCCCCCCCEEEEEeCCCcEEEE
Q 036605 160 YVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSM-----RHSPVAIDCKN-SPNGEDGTVILAVAESGVAYSW 233 (340)
Q Consensus 160 ~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~-----~~~~~~~~~~~-~~~~~~~~~l~~~s~dg~i~vw 233 (340)
++++-|++.-+++++- ||.|.+=.++.....+.+.+.|.. .....+..+.. .| +|-...+++|+.||.|.+|
T Consensus 182 ~v~~~pn~eGy~~sSi-eGRVavE~~d~s~~~~skkyaFkCHr~~~~~~~~~yPVNai~F-hp~~~tfaTgGsDG~V~~W 259 (323)
T KOG1036|consen 182 CVALVPNGEGYVVSSI-EGRVAVEYFDDSEEAQSKKYAFKCHRLSEKDTEIIYPVNAIAF-HPIHGTFATGGSDGIVNIW 259 (323)
T ss_pred EEEEecCCCceEEEee-cceEEEEccCCchHHhhhceeEEeeecccCCceEEEEeceeEe-ccccceEEecCCCceEEEc
Confidence 9999998777777777 999998887533111112222211 11111221211 33 7888899999999999999
Q ss_pred ECCCCCccCCCCC
Q 036605 234 DLKTVSQDEKTNP 246 (340)
Q Consensus 234 d~~~~~~~~~~~p 246 (340)
|+.+.+.+..+.+
T Consensus 260 d~~~rKrl~q~~~ 272 (323)
T KOG1036|consen 260 DLFNRKRLKQLAK 272 (323)
T ss_pred cCcchhhhhhccC
Confidence 9999877764544
No 114
>KOG0641 consensus WD40 repeat protein [General function prediction only]
Probab=99.87 E-value=3.4e-19 Score=135.22 Aligned_cols=217 Identities=14% Similarity=0.198 Sum_probs=158.6
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEE------ccCC--------eeEEEecCCCCCCeEEEEEecCC
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVD------VLTG--------EMKWKSTGRHPGGLAGLAFAKKG 85 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d------~~~~--------~~~~~~~~~h~~~v~~v~~~~~~ 85 (340)
.+..|.+++|+|.|. +.|+|++..+.+|-. +..+ ....+-...|.+.|+|.+|+|+|
T Consensus 31 dsqairav~fhp~g~---------lyavgsnskt~ric~yp~l~~~r~~hea~~~pp~v~~kr~khhkgsiyc~~ws~~g 101 (350)
T KOG0641|consen 31 DSQAIRAVAFHPAGG---------LYAVGSNSKTFRICAYPALIDLRHAHEAAKQPPSVLCKRNKHHKGSIYCTAWSPCG 101 (350)
T ss_pred chhheeeEEecCCCc---------eEEeccCCceEEEEccccccCcccccccccCCCeEEeeeccccCccEEEEEecCcc
Confidence 457899999999999 999999999998853 2211 12222233489999999999999
Q ss_pred CEEEEEeCCCcEEEEeCCCCe-----EEEEeecCCCCeeEEEEccC----CCEEEEe-cCc--EEEEECCCCceeEEeec
Q 036605 86 RSLHVVGTNGMASEMKSEMGE-----VIREFKASEKPISSSAFLCE----EKIFALA-SSE--VRILSLENGEEVLKFSD 153 (340)
Q Consensus 86 ~~l~s~~~dg~i~~wd~~~~~-----~~~~~~~~~~~i~~l~~~~~----~~~l~~~-~~~--i~i~d~~~~~~~~~~~~ 153 (340)
.++++|+.|..|++....... .-.+|..|.+.|..++|-.+ +.+|+++ .++ |++-|...|+.+..+.+
T Consensus 102 eliatgsndk~ik~l~fn~dt~~~~g~dle~nmhdgtirdl~fld~~~s~~~il~s~gagdc~iy~tdc~~g~~~~a~sg 181 (350)
T KOG0641|consen 102 ELIATGSNDKTIKVLPFNADTCNATGHDLEFNMHDGTIRDLAFLDDPESGGAILASAGAGDCKIYITDCGRGQGFHALSG 181 (350)
T ss_pred CeEEecCCCceEEEEecccccccccCcceeeeecCCceeeeEEecCCCcCceEEEecCCCcceEEEeecCCCCcceeecC
Confidence 999999999999987654322 12347778899999999754 4567663 333 88889999999999999
Q ss_pred CCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecC----CCeeeeeecCCCCCCCCEEEEEeCCCc
Q 036605 154 DVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRH----SPVAIDCKNSPNGEDGTVILAVAESGV 229 (340)
Q Consensus 154 ~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~----~~~~~~~~~~~~~~~~~~l~~~s~dg~ 229 (340)
|.+.|.++- +=++-.+++++. |.+|++||++.+.... .+...+.. ...+..+ +. .|.|.+|++|-.|..
T Consensus 182 htghilaly-swn~~m~~sgsq-dktirfwdlrv~~~v~--~l~~~~~~~glessavaav--~v-dpsgrll~sg~~dss 254 (350)
T KOG0641|consen 182 HTGHILALY-SWNGAMFASGSQ-DKTIRFWDLRVNSCVN--TLDNDFHDGGLESSAVAAV--AV-DPSGRLLASGHADSS 254 (350)
T ss_pred CcccEEEEE-EecCcEEEccCC-CceEEEEeeeccceee--eccCcccCCCcccceeEEE--EE-CCCcceeeeccCCCc
Confidence 999887652 335667777655 9999999997544211 11111111 1122222 33 799999999999999
Q ss_pred EEEEECCCCCccCCCCCceEEEe
Q 036605 230 AYSWDLKTVSQDEKTNPAKITVK 252 (340)
Q Consensus 230 i~vwd~~~~~~~~~~~p~~i~~~ 252 (340)
..+||++.++.+..+-|+...+.
T Consensus 255 c~lydirg~r~iq~f~phsadir 277 (350)
T KOG0641|consen 255 CMLYDIRGGRMIQRFHPHSADIR 277 (350)
T ss_pred eEEEEeeCCceeeeeCCCcccee
Confidence 99999999999988888665554
No 115
>KOG0301 consensus Phospholipase A2-activating protein (contains WD40 repeats) [Lipid transport and metabolism]
Probab=99.86 E-value=2.3e-20 Score=161.97 Aligned_cols=193 Identities=15% Similarity=0.211 Sum_probs=158.4
Q ss_pred CCCCCeEE-EEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcE
Q 036605 19 EPVVSYSC-LACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMA 97 (340)
Q Consensus 19 ~~~~~v~~-l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i 97 (340)
+|.+-+.+ +++-+..+ -.+++|+.|++|.+|.+........+.+ |++.|.+++...++. +++||.|.++
T Consensus 55 ~~~g~i~~~i~y~e~~~--------~~l~~g~~D~~i~v~~~~~~~P~~~Lkg-H~snVC~ls~~~~~~-~iSgSWD~Ta 124 (745)
T KOG0301|consen 55 GPKGFIANSICYAESDK--------GRLVVGGMDTTIIVFKLSQAEPLYTLKG-HKSNVCSLSIGEDGT-LISGSWDSTA 124 (745)
T ss_pred cCcceeeccceeccccC--------cceEeecccceEEEEecCCCCchhhhhc-cccceeeeecCCcCc-eEecccccce
Confidence 45555555 66765322 0499999999999999999999999999 999999999877776 9999999999
Q ss_pred EEEeCCCCeEEEEeecCCCCeeEEEEccCCCEE-EEecCcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcC
Q 036605 98 SEMKSEMGEVIREFKASEKPISSSAFLCEEKIF-ALASSEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYG 176 (340)
Q Consensus 98 ~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l-~~~~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~ 176 (340)
++|-. ++....+.+|...|++++.-|++.++ .++|..|++|.- ++.++.|.+|...|+.+++-+++ .|++++.
T Consensus 125 kvW~~--~~l~~~l~gH~asVWAv~~l~e~~~vTgsaDKtIklWk~--~~~l~tf~gHtD~VRgL~vl~~~-~flScsN- 198 (745)
T KOG0301|consen 125 KVWRI--GELVYSLQGHTASVWAVASLPENTYVTGSADKTIKLWKG--GTLLKTFSGHTDCVRGLAVLDDS-HFLSCSN- 198 (745)
T ss_pred EEecc--hhhhcccCCcchheeeeeecCCCcEEeccCcceeeeccC--CchhhhhccchhheeeeEEecCC-CeEeecC-
Confidence 99975 55666799999999999999998554 225555999975 67789999999999999999886 5777677
Q ss_pred CCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECC
Q 036605 177 EKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 177 d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
||.|+.|++ .++.+.... +|...++.+ .. ..++..++++++|+++++|+..
T Consensus 199 Dg~Ir~w~~---~ge~l~~~~---ghtn~vYsi--s~-~~~~~~Ivs~gEDrtlriW~~~ 249 (745)
T KOG0301|consen 199 DGSIRLWDL---DGEVLLEMH---GHTNFVYSI--SM-ALSDGLIVSTGEDRTLRIWKKD 249 (745)
T ss_pred CceEEEEec---cCceeeeee---ccceEEEEE--Ee-cCCCCeEEEecCCceEEEeecC
Confidence 999999997 555555555 788888777 33 4677889999999999999987
No 116
>KOG0294 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.86 E-value=2.6e-20 Score=147.61 Aligned_cols=177 Identities=16% Similarity=0.214 Sum_probs=135.8
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
|||..+...+..+. .|.+.|+|+.|.++-. ...|++|+.||.|.+|+...-+.+..+.. |.+.|+.++
T Consensus 67 IYDm~k~~qlg~ll----~HagsitaL~F~~~~S-------~shLlS~sdDG~i~iw~~~~W~~~~slK~-H~~~Vt~ls 134 (362)
T KOG0294|consen 67 IYDMRKRKQLGILL----SHAGSITALKFYPPLS-------KSHLLSGSDDGHIIIWRVGSWELLKSLKA-HKGQVTDLS 134 (362)
T ss_pred EEeccchhhhccee----ccccceEEEEecCCcc-------hhheeeecCCCcEEEEEcCCeEEeeeecc-cccccceeE
Confidence 46666665555555 7899999999988762 11699999999999999999889999998 999999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecC---------------------------------------CCCeeEE
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKAS---------------------------------------EKPISSS 121 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~---------------------------------------~~~i~~l 121 (340)
.+|.+++.++.+.|+.++.||+-.|+.-..+.-. ...+.++
T Consensus 135 iHPS~KLALsVg~D~~lr~WNLV~Gr~a~v~~L~~~at~v~w~~~Gd~F~v~~~~~i~i~q~d~A~v~~~i~~~~r~l~~ 214 (362)
T KOG0294|consen 135 IHPSGKLALSVGGDQVLRTWNLVRGRVAFVLNLKNKATLVSWSPQGDHFVVSGRNKIDIYQLDNASVFREIENPKRILCA 214 (362)
T ss_pred ecCCCceEEEEcCCceeeeehhhcCccceeeccCCcceeeEEcCCCCEEEEEeccEEEEEecccHhHhhhhhccccceee
Confidence 9999999999999999999999887643222111 1112233
Q ss_pred EEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEE--CCCCCEEEEEEcCCCeEEEEEccCCCCC
Q 036605 122 AFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSA--SDGAKIIITAGYGEKHLQVWRCDISSKT 191 (340)
Q Consensus 122 ~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~--s~~~~~l~s~~~~d~~i~iwd~~~~~~~ 191 (340)
.|.. +..|++|+.+ |.+||..+..++..|.+|...|.++.+ .|++.||+++++ ||.|+|||+++.+++
T Consensus 215 ~~l~-~~~L~vG~d~~~i~~~D~ds~~~~~~~~AH~~RVK~i~~~~~~~~~~lvTaSS-DG~I~vWd~~~~~k~ 286 (362)
T KOG0294|consen 215 TFLD-GSELLVGGDNEWISLKDTDSDTPLTEFLAHENRVKDIASYTNPEHEYLVTASS-DGFIKVWDIDMETKK 286 (362)
T ss_pred eecC-CceEEEecCCceEEEeccCCCccceeeecchhheeeeEEEecCCceEEEEecc-CceEEEEEccccccC
Confidence 3322 2333343333 888888888888889999999999985 677889999888 999999999765543
No 117
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.86 E-value=8.3e-21 Score=145.38 Aligned_cols=202 Identities=19% Similarity=0.239 Sum_probs=156.1
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe---eEEEecCCCCCCeEEEEEec--CCCEEEEEeC
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE---MKWKSTGRHPGGLAGLAFAK--KGRSLHVVGT 93 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~---~~~~~~~~h~~~v~~v~~~~--~~~~l~s~~~ 93 (340)
.|...|......--|+ .||+++.|++|+|+.++... .+..+.+ |.++|..++|.. -|..|++|+.
T Consensus 9 ~H~D~IHda~lDyygk---------rlATcsSD~tVkIf~v~~n~~s~ll~~L~G-h~GPVwqv~wahPk~G~iLAScsY 78 (299)
T KOG1332|consen 9 QHEDMIHDAQLDYYGK---------RLATCSSDGTVKIFEVRNNGQSKLLAELTG-HSGPVWKVAWAHPKFGTILASCSY 78 (299)
T ss_pred hhhhhhhHhhhhhhcc---------eeeeecCCccEEEEEEcCCCCceeeeEecC-CCCCeeEEeecccccCcEeeEeec
Confidence 6777787777766687 89999999999999988654 5677888 999999999975 7899999999
Q ss_pred CCcEEEEeCCCCe--EEEEeecCCCCeeEEEEccCC--CEEEE--ecCcEEEEECCCC-c--eeEEeecCCCCeEEEEEC
Q 036605 94 NGMASEMKSEMGE--VIREFKASEKPISSSAFLCEE--KIFAL--ASSEVRILSLENG-E--EVLKFSDDVGPLQYVSAS 164 (340)
Q Consensus 94 dg~i~~wd~~~~~--~~~~~~~~~~~i~~l~~~~~~--~~l~~--~~~~i~i~d~~~~-~--~~~~~~~~~~~v~~~~~s 164 (340)
||.|.+|.-.+|+ ....+..|...|++++|.|.+ ..|++ .|++|.+.+.+.. . .......|.-.|++++|.
T Consensus 79 DgkVIiWke~~g~w~k~~e~~~h~~SVNsV~wapheygl~LacasSDG~vsvl~~~~~g~w~t~ki~~aH~~GvnsVswa 158 (299)
T KOG1332|consen 79 DGKVIIWKEENGRWTKAYEHAAHSASVNSVAWAPHEYGLLLACASSDGKVSVLTYDSSGGWTTSKIVFAHEIGVNSVSWA 158 (299)
T ss_pred CceEEEEecCCCchhhhhhhhhhcccceeecccccccceEEEEeeCCCcEEEEEEcCCCCccchhhhhccccccceeeec
Confidence 9999999988774 233466789999999999975 45555 4556888777543 1 224457899999999998
Q ss_pred CC---C-----------CEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCC---CCCCEEEEEeCC
Q 036605 165 DG---A-----------KIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNG---EDGTVILAVAES 227 (340)
Q Consensus 165 ~~---~-----------~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~---~~~~~l~~~s~d 227 (340)
|. | +.|+++|. |+.|+||+.+...-.....+. .|..++.++ +|.+ -...++++++.|
T Consensus 159 pa~~~g~~~~~~~~~~~krlvSgGc-Dn~VkiW~~~~~~w~~e~~l~---~H~dwVRDV--AwaP~~gl~~s~iAS~SqD 232 (299)
T KOG1332|consen 159 PASAPGSLVDQGPAAKVKRLVSGGC-DNLVKIWKFDSDSWKLERTLE---GHKDWVRDV--AWAPSVGLPKSTIASCSQD 232 (299)
T ss_pred CcCCCccccccCcccccceeeccCC-ccceeeeecCCcchhhhhhhh---hcchhhhhh--hhccccCCCceeeEEecCC
Confidence 76 4 56899888 999999998432212222344 788899888 5521 223579999999
Q ss_pred CcEEEEECC
Q 036605 228 GVAYSWDLK 236 (340)
Q Consensus 228 g~i~vwd~~ 236 (340)
|++.||...
T Consensus 233 g~viIwt~~ 241 (299)
T KOG1332|consen 233 GTVIIWTKD 241 (299)
T ss_pred CcEEEEEec
Confidence 999999876
No 118
>KOG0269 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.86 E-value=3.1e-21 Score=169.24 Aligned_cols=185 Identities=15% Similarity=0.177 Sum_probs=143.1
Q ss_pred EEEEEcCCCcEEEEEccC---CeeEEEecCCCCCCeEEEEEec-CCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCee
Q 036605 44 LLALGTSNGDILAVDVLT---GEMKWKSTGRHPGGLAGLAFAK-KGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPIS 119 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~---~~~~~~~~~~h~~~v~~v~~~~-~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~ 119 (340)
+||+++.+|.|.+||+.. .+.+..|.. |...++++.|++ ...+|++|+.||.|++||++..+....+.+....|.
T Consensus 102 lIAT~s~nG~i~vWdlnk~~rnk~l~~f~E-H~Rs~~~ldfh~tep~iliSGSQDg~vK~~DlR~~~S~~t~~~nSESiR 180 (839)
T KOG0269|consen 102 LIATCSTNGVISVWDLNKSIRNKLLTVFNE-HERSANKLDFHSTEPNILISGSQDGTVKCWDLRSKKSKSTFRSNSESIR 180 (839)
T ss_pred hheeecCCCcEEEEecCccccchhhhHhhh-hccceeeeeeccCCccEEEecCCCceEEEEeeecccccccccccchhhh
Confidence 899999999999999987 445556776 999999999998 456899999999999999999998888888888999
Q ss_pred EEEEccCC-CEEEEe--cCcEEEEECCCCc-eeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCC
Q 036605 120 SSAFLCEE-KIFALA--SSEVRILSLENGE-EVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKG 195 (340)
Q Consensus 120 ~l~~~~~~-~~l~~~--~~~i~i~d~~~~~-~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~ 195 (340)
.+.|+|.. ..++++ +|.+.+||++... ...++.+|.++|.++.|+|++.+|++||. |+.|+|||+. ..+....
T Consensus 181 DV~fsp~~~~~F~s~~dsG~lqlWDlRqp~r~~~k~~AH~GpV~c~nwhPnr~~lATGGR-DK~vkiWd~t--~~~~~~~ 257 (839)
T KOG0269|consen 181 DVKFSPGYGNKFASIHDSGYLQLWDLRQPDRCEKKLTAHNGPVLCLNWHPNREWLATGGR-DKMVKIWDMT--DSRAKPK 257 (839)
T ss_pred ceeeccCCCceEEEecCCceEEEeeccCchhHHHHhhcccCceEEEeecCCCceeeecCC-CccEEEEecc--CCCccce
Confidence 99999964 455553 3449999998753 45788999999999999999999999886 9999999983 3222222
Q ss_pred ceeeecCCCeeeeeecCCCCCCC-CEEEEEe--CCCcEEEEECCC
Q 036605 196 PALSMRHSPVAIDCKNSPNGEDG-TVILAVA--ESGVAYSWDLKT 237 (340)
Q Consensus 196 ~~~~~~~~~~~~~~~~~~~~~~~-~~l~~~s--~dg~i~vwd~~~ 237 (340)
... .....+..+ .| .|+. ..|++++ .|-.|+|||+..
T Consensus 258 ~tI--nTiapv~rV--kW-RP~~~~hLAtcsmv~dtsV~VWDvrR 297 (839)
T KOG0269|consen 258 HTI--NTIAPVGRV--KW-RPARSYHLATCSMVVDTSVHVWDVRR 297 (839)
T ss_pred eEE--eecceeeee--ee-ccCccchhhhhhccccceEEEEeecc
Confidence 221 222223333 44 4444 4455544 366799999976
No 119
>KOG0305 consensus Anaphase promoting complex, Cdc20, Cdh1, and Ama1 subunits [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=99.86 E-value=1.1e-20 Score=162.95 Aligned_cols=155 Identities=17% Similarity=0.213 Sum_probs=140.2
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEec-CCCEEEEEe--CCC
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAK-KGRSLHVVG--TNG 95 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~-~~~~l~s~~--~dg 95 (340)
+|...|..+.|++|+. +||+|+.|+.+.|||....+.+..+.. |.+.|.+++|+| ....||+|+ .|+
T Consensus 299 ~H~qeVCgLkws~d~~---------~lASGgnDN~~~Iwd~~~~~p~~~~~~-H~aAVKA~awcP~q~~lLAsGGGs~D~ 368 (484)
T KOG0305|consen 299 GHRQEVCGLKWSPDGN---------QLASGGNDNVVFIWDGLSPEPKFTFTE-HTAAVKALAWCPWQSGLLATGGGSADR 368 (484)
T ss_pred cccceeeeeEECCCCC---------eeccCCCccceEeccCCCccccEEEec-cceeeeEeeeCCCccCceEEcCCCccc
Confidence 8999999999999999 999999999999999987788888888 999999999999 455788864 689
Q ss_pred cEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecC----cEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEE
Q 036605 96 MASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASS----EVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIII 171 (340)
Q Consensus 96 ~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~----~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~ 171 (340)
.|++||..+|..+.... ....|+.|.|++..+.++++-+ +|.||+..+.+.+..+.+|...|..++++|||..++
T Consensus 369 ~i~fwn~~~g~~i~~vd-tgsQVcsL~Wsk~~kEi~sthG~s~n~i~lw~~ps~~~~~~l~gH~~RVl~la~SPdg~~i~ 447 (484)
T KOG0305|consen 369 CIKFWNTNTGARIDSVD-TGSQVCSLIWSKKYKELLSTHGYSENQITLWKYPSMKLVAELLGHTSRVLYLALSPDGETIV 447 (484)
T ss_pred EEEEEEcCCCcEecccc-cCCceeeEEEcCCCCEEEEecCCCCCcEEEEeccccceeeeecCCcceeEEEEECCCCCEEE
Confidence 99999999999887765 3567999999999988877433 399999999999999999999999999999999999
Q ss_pred EEEcCCCeEEEEEc
Q 036605 172 TAGYGEKHLQVWRC 185 (340)
Q Consensus 172 s~~~~d~~i~iwd~ 185 (340)
+++. |.++++|++
T Consensus 448 t~a~-DETlrfw~~ 460 (484)
T KOG0305|consen 448 TGAA-DETLRFWNL 460 (484)
T ss_pred Eecc-cCcEEeccc
Confidence 9888 999999998
No 120
>KOG0270 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.86 E-value=2.5e-20 Score=153.89 Aligned_cols=208 Identities=16% Similarity=0.159 Sum_probs=158.5
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecC-CCEEEEEeCCCc
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKK-GRSLHVVGTNGM 96 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~-~~~l~s~~~dg~ 96 (340)
.+|+..|..|+|...-+ ..||+|+.|.+|.+||+.+|++...+.. |.+.|.++.|+|. ...|++|+.|++
T Consensus 240 ~gHTdavl~Ls~n~~~~--------nVLaSgsaD~TV~lWD~~~g~p~~s~~~-~~k~Vq~l~wh~~~p~~LLsGs~D~~ 310 (463)
T KOG0270|consen 240 SGHTDAVLALSWNRNFR--------NVLASGSADKTVKLWDVDTGKPKSSITH-HGKKVQTLEWHPYEPSVLLSGSYDGT 310 (463)
T ss_pred ccchHHHHHHHhccccc--------eeEEecCCCceEEEEEcCCCCcceehhh-cCCceeEEEecCCCceEEEeccccce
Confidence 37888999999986653 2899999999999999999999999987 9999999999994 568999999999
Q ss_pred EEEEeCCCCe-EEEEeecCCCCeeEEEEccCCCEEEEe---cCcEEEEECCCC-ceeEEeecCCCCeEEEEECCCCCEEE
Q 036605 97 ASEMKSEMGE-VIREFKASEKPISSSAFLCEEKIFALA---SSEVRILSLENG-EEVLKFSDDVGPLQYVSASDGAKIII 171 (340)
Q Consensus 97 i~~wd~~~~~-~~~~~~~~~~~i~~l~~~~~~~~l~~~---~~~i~i~d~~~~-~~~~~~~~~~~~v~~~~~s~~~~~l~ 171 (340)
|.+.|.+.-. .-..|+ -.+.|..++|.|.....+.+ +|.++-+|++.. +++.++..|..+|.++++++.-..++
T Consensus 311 V~l~D~R~~~~s~~~wk-~~g~VEkv~w~~~se~~f~~~tddG~v~~~D~R~~~~~vwt~~AHd~~ISgl~~n~~~p~~l 389 (463)
T KOG0270|consen 311 VALKDCRDPSNSGKEWK-FDGEVEKVAWDPHSENSFFVSTDDGTVYYFDIRNPGKPVWTLKAHDDEISGLSVNIQTPGLL 389 (463)
T ss_pred EEeeeccCccccCceEE-eccceEEEEecCCCceeEEEecCCceEEeeecCCCCCceeEEEeccCCcceEEecCCCCcce
Confidence 9999998422 222233 24578899999977655443 466999999875 88899999999999999999887777
Q ss_pred EEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCc
Q 036605 172 TAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQ 240 (340)
Q Consensus 172 s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~ 240 (340)
+.+..|+.|++|++............+.++. ..+. .+......+++.|+..+.++|||+.+...
T Consensus 390 ~t~s~d~~Vklw~~~~~~~~~v~~~~~~~~r----l~c~-~~~~~~a~~la~GG~k~~~~vwd~~~~~~ 453 (463)
T KOG0270|consen 390 STASTDKVVKLWKFDVDSPKSVKEHSFKLGR----LHCF-ALDPDVAFTLAFGGEKAVLRVWDIFTNSP 453 (463)
T ss_pred eeccccceEEEEeecCCCCcccccccccccc----eeec-ccCCCcceEEEecCccceEEEeecccChh
Confidence 7677799999999964444433333332222 1111 11133445678888888999999987543
No 121
>KOG0639 consensus Transducin-like enhancer of split protein (contains WD40 repeats) [Chromatin structure and dynamics]
Probab=99.86 E-value=3.5e-21 Score=161.40 Aligned_cols=209 Identities=17% Similarity=0.219 Sum_probs=165.0
Q ss_pred CccCCCCc--eeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEE
Q 036605 1 IWSTNDGS--LLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAG 78 (340)
Q Consensus 1 vwd~~~g~--~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~ 78 (340)
|||+.... +..+++ .-.-.|.+|+.+||.+ +.+++..||.|.|||+.+...++.|++ |++.+.|
T Consensus 491 iWDLAapTprikaelt----ssapaCyALa~spDak---------vcFsccsdGnI~vwDLhnq~~VrqfqG-htDGasc 556 (705)
T KOG0639|consen 491 IWDLAAPTPRIKAELT----SSAPACYALAISPDAK---------VCFSCCSDGNIAVWDLHNQTLVRQFQG-HTDGASC 556 (705)
T ss_pred eeeccCCCcchhhhcC----CcchhhhhhhcCCccc---------eeeeeccCCcEEEEEcccceeeecccC-CCCCcee
Confidence 68876554 334444 2335678899999999 999999999999999999999999999 9999999
Q ss_pred EEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCC
Q 036605 79 LAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVG 156 (340)
Q Consensus 79 v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~ 156 (340)
|..++||..|.+|+-|.+|+.||+++++.+.... ..+.|.++..+|.+.+++++-.. +.+..... .....+..|.+
T Consensus 557 Idis~dGtklWTGGlDntvRcWDlregrqlqqhd-F~SQIfSLg~cP~~dWlavGMens~vevlh~sk-p~kyqlhlheS 634 (705)
T KOG0639|consen 557 IDISKDGTKLWTGGLDNTVRCWDLREGRQLQQHD-FSSQIFSLGYCPTGDWLAVGMENSNVEVLHTSK-PEKYQLHLHES 634 (705)
T ss_pred EEecCCCceeecCCCccceeehhhhhhhhhhhhh-hhhhheecccCCCccceeeecccCcEEEEecCC-ccceeeccccc
Confidence 9999999999999999999999999998765543 24578999999999999996555 55544332 23466777899
Q ss_pred CeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEEC
Q 036605 157 PLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDL 235 (340)
Q Consensus 157 ~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~ 235 (340)
.|.++.|.+.|+++++.+. |+.+..|.. .-+..+... .....+..+ - .+.|..++++|+.|....||.+
T Consensus 635 cVLSlKFa~cGkwfvStGk-DnlLnawrt--PyGasiFqs----kE~SsVlsC--D-IS~ddkyIVTGSGdkkATVYeV 703 (705)
T KOG0639|consen 635 CVLSLKFAYCGKWFVSTGK-DNLLNAWRT--PYGASIFQS----KESSSVLSC--D-ISFDDKYIVTGSGDKKATVYEV 703 (705)
T ss_pred EEEEEEecccCceeeecCc-hhhhhhccC--ccccceeec----cccCcceee--e-eccCceEEEecCCCcceEEEEE
Confidence 9999999999999999998 999999998 334322211 222223222 2 2778899999999998888875
No 122
>KOG2919 consensus Guanine nucleotide-binding protein [General function prediction only]
Probab=99.85 E-value=9.2e-20 Score=145.09 Aligned_cols=236 Identities=16% Similarity=0.179 Sum_probs=163.6
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecC-CCCCC---eEEEEEecCCCEEEEEeCCCcE
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTG-RHPGG---LAGLAFAKKGRSLHVVGTNGMA 97 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~-~h~~~---v~~v~~~~~~~~l~s~~~dg~i 97 (340)
..|...+|-+--+ .-...+.++|+.+.+.-|++||..+|+....+.. -|... ..+++|+|||.+|+. +....|
T Consensus 105 ~tvydy~wYs~M~--s~qP~t~l~a~ssr~~PIh~wdaftG~lraSy~~ydh~de~taAhsL~Fs~DGeqlfa-Gykrci 181 (406)
T KOG2919|consen 105 ETVYDYCWYSRMK--SDQPSTNLFAVSSRDQPIHLWDAFTGKLRASYRAYDHQDEYTAAHSLQFSPDGEQLFA-GYKRCI 181 (406)
T ss_pred CEEEEEEeeeccc--cCCCccceeeeccccCceeeeeccccccccchhhhhhHHhhhhheeEEecCCCCeEee-cccceE
Confidence 4566666742111 0011234999999999999999999998777654 24433 468999999999997 556799
Q ss_pred EEEeC-CCCeEEEE---e----ecCCCCeeEEEEccCCC-EEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCC
Q 036605 98 SEMKS-EMGEVIRE---F----KASEKPISSSAFLCEEK-IFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDG 166 (340)
Q Consensus 98 ~~wd~-~~~~~~~~---~----~~~~~~i~~l~~~~~~~-~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~ 166 (340)
+++|+ +.|.-... + .+..+.+.+++|+|-.. .+++++.- +-||.-..+.++..+-+|.+.|+.++|.++
T Consensus 182 rvFdt~RpGr~c~vy~t~~~~k~gq~giisc~a~sP~~~~~~a~gsY~q~~giy~~~~~~pl~llggh~gGvThL~~~ed 261 (406)
T KOG2919|consen 182 RVFDTSRPGRDCPVYTTVTKGKFGQKGIISCFAFSPMDSKTLAVGSYGQRVGIYNDDGRRPLQLLGGHGGGVTHLQWCED 261 (406)
T ss_pred EEeeccCCCCCCcchhhhhcccccccceeeeeeccCCCCcceeeecccceeeeEecCCCCceeeecccCCCeeeEEeccC
Confidence 99998 55542211 1 12356789999999765 66665443 777777778888888999999999999999
Q ss_pred CCEEEEEEcCCCeEEEEEccCCCCCccCCceeeec--CCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC-CCccCC
Q 036605 167 AKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMR--HSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT-VSQDEK 243 (340)
Q Consensus 167 ~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~--~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~-~~~~~~ 243 (340)
|+.|++++..|..|-.||+| ..+..+-.+.-..+ .....+++ .|.+.+|++|+.||.|++||++. +.....
T Consensus 262 Gn~lfsGaRk~dkIl~WDiR-~~~~pv~~L~rhv~~TNQRI~FDl-----d~~~~~LasG~tdG~V~vwdlk~~gn~~sv 335 (406)
T KOG2919|consen 262 GNKLFSGARKDDKILCWDIR-YSRDPVYALERHVGDTNQRILFDL-----DPKGEILASGDTDGSVRVWDLKDLGNEVSV 335 (406)
T ss_pred cCeecccccCCCeEEEEeeh-hccchhhhhhhhccCccceEEEec-----CCCCceeeccCCCccEEEEecCCCCCcccc
Confidence 99999999999999999997 33333222221111 22334455 89999999999999999999998 443432
Q ss_pred CCCceEEEeecccccccccccccccccceeeeee
Q 036605 244 TNPAKITVKLKKADADQQNSVNVKKSRTSIIAAR 277 (340)
Q Consensus 244 ~~p~~i~~~~~~~~~~~~~~~~~~~~~~~i~~~~ 277 (340)
+.+.+. ..+++...|. .||++..
T Consensus 336 ~~~~sd----------~vNgvslnP~-mpilats 358 (406)
T KOG2919|consen 336 TGNYSD----------TVNGVSLNPI-MPILATS 358 (406)
T ss_pred cccccc----------cccceecCcc-cceeeec
Confidence 323222 2233445555 5776665
No 123
>KOG0646 consensus WD40 repeat protein [General function prediction only]
Probab=99.85 E-value=4.1e-20 Score=153.58 Aligned_cols=179 Identities=14% Similarity=0.202 Sum_probs=149.0
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEcc---------CCeeEEEecCC
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVL---------TGEMKWKSTGR 71 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~---------~~~~~~~~~~~ 71 (340)
+|.+.+|.++..+. .|-..|+|+.|+-|+. +|++|+.||.|.+|++. +.+..+.+..
T Consensus 107 lWelssG~LL~v~~----aHYQ~ITcL~fs~dgs---------~iiTgskDg~V~vW~l~~lv~a~~~~~~~p~~~f~~- 172 (476)
T KOG0646|consen 107 LWELSSGILLNVLS----AHYQSITCLKFSDDGS---------HIITGSKDGAVLVWLLTDLVSADNDHSVKPLHIFSD- 172 (476)
T ss_pred EEEeccccHHHHHH----hhccceeEEEEeCCCc---------EEEecCCCccEEEEEEEeecccccCCCccceeeecc-
Confidence 69999999998886 8999999999999999 99999999999999864 2346777888
Q ss_pred CCCCeEEEEEecC--CCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCC---
Q 036605 72 HPGGLAGLAFAKK--GRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLEN--- 144 (340)
Q Consensus 72 h~~~v~~v~~~~~--~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~--- 144 (340)
|.-+|+++...+. ..+|+++|.|.++++||+..|..+.++.. ...+.+++++|.++.+++|..+ |.+.++..
T Consensus 173 HtlsITDl~ig~Gg~~~rl~TaS~D~t~k~wdlS~g~LLlti~f-p~si~av~lDpae~~~yiGt~~G~I~~~~~~~~~~ 251 (476)
T KOG0646|consen 173 HTLSITDLQIGSGGTNARLYTASEDRTIKLWDLSLGVLLLTITF-PSSIKAVALDPAERVVYIGTEEGKIFQNLLFKLSG 251 (476)
T ss_pred CcceeEEEEecCCCccceEEEecCCceEEEEEeccceeeEEEec-CCcceeEEEcccccEEEecCCcceEEeeehhcCCc
Confidence 9999999988764 35899999999999999999998888754 5678999999999999887666 55555432
Q ss_pred -------------CceeEEeecCCC--CeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCce
Q 036605 145 -------------GEEVLKFSDDVG--PLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPA 197 (340)
Q Consensus 145 -------------~~~~~~~~~~~~--~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~ 197 (340)
+..+..+.+|.+ .|++++++-||..|++|+. ||.++|||+ .+++.++.+.
T Consensus 252 ~~~~v~~k~~~~~~t~~~~~~Gh~~~~~ITcLais~DgtlLlSGd~-dg~VcvWdi--~S~Q~iRtl~ 316 (476)
T KOG0646|consen 252 QSAGVNQKGRHEENTQINVLVGHENESAITCLAISTDGTLLLSGDE-DGKVCVWDI--YSKQCIRTLQ 316 (476)
T ss_pred ccccccccccccccceeeeeccccCCcceeEEEEecCccEEEeeCC-CCCEEEEec--chHHHHHHHh
Confidence 223466788888 9999999999999999777 999999999 5655554443
No 124
>KOG1408 consensus WD40 repeat protein [Function unknown]
Probab=99.84 E-value=4.9e-20 Score=160.65 Aligned_cols=203 Identities=21% Similarity=0.237 Sum_probs=164.7
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe-eEEEecCCCCCCeEEEEEecCC--CEEEEEeCCC
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE-MKWKSTGRHPGGLAGLAFAKKG--RSLHVVGTNG 95 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~-~~~~~~~~h~~~v~~v~~~~~~--~~l~s~~~dg 95 (340)
.|+.+|.||.||...-.+ .+||+++.|..|+|||+...- ++.++.+ |...|+++.|...| ..+++|+.|.
T Consensus 499 AHesEilcLeyS~p~~~~------kLLASasrdRlIHV~Dv~rny~l~qtld~-HSssITsvKFa~~gln~~MiscGADk 571 (1080)
T KOG1408|consen 499 AHESEILCLEYSFPVLTN------KLLASASRDRLIHVYDVKRNYDLVQTLDG-HSSSITSVKFACNGLNRKMISCGADK 571 (1080)
T ss_pred cccceeEEEeecCchhhh------HhhhhccCCceEEEEecccccchhhhhcc-cccceeEEEEeecCCceEEEeccCch
Confidence 799999999998543211 299999999999999987543 5667777 99999999998877 6899999998
Q ss_pred cEEEEeCCCCeEEEEee-----cCCCCeeEEEEccCCCEEEEecC--cEEEEECCCCceeEEee---cCCCCeEEEEECC
Q 036605 96 MASEMKSEMGEVIREFK-----ASEKPISSSAFLCEEKIFALASS--EVRILSLENGEEVLKFS---DDVGPLQYVSASD 165 (340)
Q Consensus 96 ~i~~wd~~~~~~~~~~~-----~~~~~i~~l~~~~~~~~l~~~~~--~i~i~d~~~~~~~~~~~---~~~~~v~~~~~s~ 165 (340)
.|.+-..+.......|. ..+..++.+++.|..++++++.. .|+|||+++++..+.|+ +|.+....+...|
T Consensus 572 simFr~~qk~~~g~~f~r~t~t~~ktTlYDm~Vdp~~k~v~t~cQDrnirif~i~sgKq~k~FKgs~~~eG~lIKv~lDP 651 (1080)
T KOG1408|consen 572 SIMFRVNQKASSGRLFPRHTQTLSKTTLYDMAVDPTSKLVVTVCQDRNIRIFDIESGKQVKSFKGSRDHEGDLIKVILDP 651 (1080)
T ss_pred hhheehhccccCceeccccccccccceEEEeeeCCCcceEEEEecccceEEEeccccceeeeecccccCCCceEEEEECC
Confidence 77543322111111222 23456899999999999988544 49999999999999985 4667888999999
Q ss_pred CCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 166 GAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 166 ~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
.|.|++++.. |.++.++|+ .+++...... +|...+..+ .| .+|.++|++++.||.|.||.+..
T Consensus 652 SgiY~atScs-dktl~~~Df--~sgEcvA~m~---GHsE~VTG~--kF-~nDCkHlISvsgDgCIFvW~lp~ 714 (1080)
T KOG1408|consen 652 SGIYLATSCS-DKTLCFVDF--VSGECVAQMT---GHSEAVTGV--KF-LNDCKHLISVSGDGCIFVWKLPL 714 (1080)
T ss_pred CccEEEEeec-CCceEEEEe--ccchhhhhhc---Ccchheeee--ee-cccchhheeecCCceEEEEECch
Confidence 9999999888 999999999 7888888777 898888887 77 78999999999999999999875
No 125
>KOG0308 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.84 E-value=6.6e-20 Score=158.13 Aligned_cols=215 Identities=13% Similarity=0.142 Sum_probs=169.6
Q ss_pred CccCCCC--ceeeeeeCCCCCCCCCeEEEEe-eccccccccccCceEEEEEcCCCcEEEEEccCCe--eEE--------E
Q 036605 1 IWSTNDG--SLLAEWKQPDGEPVVSYSCLAC-GFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE--MKW--------K 67 (340)
Q Consensus 1 vwd~~~g--~~~~~~~~~~~~~~~~v~~l~~-sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~--~~~--------~ 67 (340)
+|+...+ -+...+. .|..-|.|++. .++.. ++|+|+-|+.|.+||+.++. .+. .
T Consensus 99 ~W~~~~~~~~c~stir----~H~DYVkcla~~ak~~~---------lvaSgGLD~~IflWDin~~~~~l~~s~n~~t~~s 165 (735)
T KOG0308|consen 99 VWNAHKDNTFCMSTIR----THKDYVKCLAYIAKNNE---------LVASGGLDRKIFLWDINTGTATLVASFNNVTVNS 165 (735)
T ss_pred EeecccCcchhHhhhh----cccchheeeeecccCce---------eEEecCCCccEEEEEccCcchhhhhhcccccccc
Confidence 4777665 3444554 89999999999 77777 89999999999999999872 222 2
Q ss_pred ecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCC
Q 036605 68 STGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENG 145 (340)
Q Consensus 68 ~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~ 145 (340)
+..++..+|++++.++.|..+++|+..+.+++||.++++.+..+.+|...|.++.+++||..+++++.+ |++||+...
T Consensus 166 l~sG~k~siYSLA~N~t~t~ivsGgtek~lr~wDprt~~kimkLrGHTdNVr~ll~~dDGt~~ls~sSDgtIrlWdLgqQ 245 (735)
T KOG0308|consen 166 LGSGPKDSIYSLAMNQTGTIIVSGGTEKDLRLWDPRTCKKIMKLRGHTDNVRVLLVNDDGTRLLSASSDGTIRLWDLGQQ 245 (735)
T ss_pred CCCCCccceeeeecCCcceEEEecCcccceEEeccccccceeeeeccccceEEEEEcCCCCeEeecCCCceEEeeecccc
Confidence 231488899999999999999999999999999999999999999999999999999999999886555 999999999
Q ss_pred ceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEe
Q 036605 146 EEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVA 225 (340)
Q Consensus 146 ~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s 225 (340)
+++.++..|...|+++..+|+-.++++|+. |+.|..=|++... .....+...++...... +....-+-+++
T Consensus 246 rCl~T~~vH~e~VWaL~~~~sf~~vYsG~r-d~~i~~Tdl~n~~---~~tlick~daPv~~l~~-----~~~~~~~WvtT 316 (735)
T KOG0308|consen 246 RCLATYIVHKEGVWALQSSPSFTHVYSGGR-DGNIYRTDLRNPA---KSTLICKEDAPVLKLHL-----HEHDNSVWVTT 316 (735)
T ss_pred ceeeeEEeccCceEEEeeCCCcceEEecCC-CCcEEecccCCch---hheEeecCCCchhhhhh-----ccccCCceeee
Confidence 999999999999999999999999999888 9999998985321 12222222332222222 22222346778
Q ss_pred CCCcEEEEECCC
Q 036605 226 ESGVAYSWDLKT 237 (340)
Q Consensus 226 ~dg~i~vwd~~~ 237 (340)
.|+.|.-|....
T Consensus 317 tds~I~rW~~~~ 328 (735)
T KOG0308|consen 317 TDSSIKRWKLEP 328 (735)
T ss_pred ccccceecCCcc
Confidence 899999997664
No 126
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=99.84 E-value=4.9e-18 Score=144.55 Aligned_cols=221 Identities=15% Similarity=0.120 Sum_probs=155.5
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEE-EEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLL-ALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGL 79 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l-~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v 79 (340)
+||+.+++....+. .+ ..+.+++|+|+++ .+ ++++.++.|++||..+++....+.. +. .+..+
T Consensus 15 ~~d~~t~~~~~~~~----~~-~~~~~l~~~~dg~---------~l~~~~~~~~~v~~~d~~~~~~~~~~~~-~~-~~~~~ 78 (300)
T TIGR03866 15 VIDTATLEVTRTFP----VG-QRPRGITLSKDGK---------LLYVCASDSDTIQVIDLATGEVIGTLPS-GP-DPELF 78 (300)
T ss_pred EEECCCCceEEEEE----CC-CCCCceEECCCCC---------EEEEEECCCCeEEEEECCCCcEEEeccC-CC-CccEE
Confidence 58998898887776 33 3467899999997 55 6778899999999999987776664 43 35688
Q ss_pred EEecCCCEEEEE-eCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc---EEEEECCCCceeEEeecCC
Q 036605 80 AFAKKGRSLHVV-GTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE---VRILSLENGEEVLKFSDDV 155 (340)
Q Consensus 80 ~~~~~~~~l~s~-~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~---i~i~d~~~~~~~~~~~~~~ 155 (340)
+|+|+++.++++ +.++.|.+||+.+++.+..+..+ ..+.+++|+|++.+++++... +.+||..+++....+.. .
T Consensus 79 ~~~~~g~~l~~~~~~~~~l~~~d~~~~~~~~~~~~~-~~~~~~~~~~dg~~l~~~~~~~~~~~~~d~~~~~~~~~~~~-~ 156 (300)
T TIGR03866 79 ALHPNGKILYIANEDDNLVTVIDIETRKVLAEIPVG-VEPEGMAVSPDGKIVVNTSETTNMAHFIDTKTYEIVDNVLV-D 156 (300)
T ss_pred EECCCCCEEEEEcCCCCeEEEEECCCCeEEeEeeCC-CCcceEEECCCCCEEEEEecCCCeEEEEeCCCCeEEEEEEc-C
Confidence 999999987665 46899999999998877766532 346889999999999875543 77889988876554432 2
Q ss_pred CCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeec--CCCeeeeeecCCCCCCCCEEEE-EeCCCcEEE
Q 036605 156 GPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMR--HSPVAIDCKNSPNGEDGTVILA-VAESGVAYS 232 (340)
Q Consensus 156 ~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~--~~~~~~~~~~~~~~~~~~~l~~-~s~dg~i~v 232 (340)
..+..+.|+|++.++++++..++.|.+||+ .+++....+.+... +..........+ ++++.++++ .+.++.+.+
T Consensus 157 ~~~~~~~~s~dg~~l~~~~~~~~~v~i~d~--~~~~~~~~~~~~~~~~~~~~~~~~~i~~-s~dg~~~~~~~~~~~~i~v 233 (300)
T TIGR03866 157 QRPRFAEFTADGKELWVSSEIGGTVSVIDV--ATRKVIKKITFEIPGVHPEAVQPVGIKL-TKDGKTAFVALGPANRVAV 233 (300)
T ss_pred CCccEEEECCCCCEEEEEcCCCCEEEEEEc--CcceeeeeeeecccccccccCCccceEE-CCCCCEEEEEcCCCCeEEE
Confidence 345789999999988766655899999998 44433332221110 000110011133 788887554 455678999
Q ss_pred EECCCCCccC
Q 036605 233 WDLKTVSQDE 242 (340)
Q Consensus 233 wd~~~~~~~~ 242 (340)
||+.+++...
T Consensus 234 ~d~~~~~~~~ 243 (300)
T TIGR03866 234 VDAKTYEVLD 243 (300)
T ss_pred EECCCCcEEE
Confidence 9998765443
No 127
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=99.84 E-value=3.3e-18 Score=135.40 Aligned_cols=196 Identities=14% Similarity=0.137 Sum_probs=146.3
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEE
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASE 99 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~ 99 (340)
....|+.+.|+|.+. .|+++++||++++||+........+. |.+++.+++|.+ ...+++|+.||.|+.
T Consensus 12 P~d~IS~v~f~~~~~---------~LLvssWDgslrlYdv~~~~l~~~~~--~~~plL~c~F~d-~~~~~~G~~dg~vr~ 79 (323)
T KOG1036|consen 12 PEDGISSVKFSPSSS---------DLLVSSWDGSLRLYDVPANSLKLKFK--HGAPLLDCAFAD-ESTIVTGGLDGQVRR 79 (323)
T ss_pred ChhceeeEEEcCcCC---------cEEEEeccCcEEEEeccchhhhhhee--cCCceeeeeccC-CceEEEeccCceEEE
Confidence 468899999998887 78888999999999999887666666 899999999986 668999999999999
Q ss_pred EeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec--CcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCC
Q 036605 100 MKSEMGEVIREFKASEKPISSSAFLCEEKIFALAS--SEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGE 177 (340)
Q Consensus 100 wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~--~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d 177 (340)
+|+.++... .+..|..++.||..++....+++++ +.|++||.+.......+.. ...|.++... +..|+.++. +
T Consensus 80 ~Dln~~~~~-~igth~~~i~ci~~~~~~~~vIsgsWD~~ik~wD~R~~~~~~~~d~-~kkVy~~~v~--g~~LvVg~~-~ 154 (323)
T KOG1036|consen 80 YDLNTGNED-QIGTHDEGIRCIEYSYEVGCVISGSWDKTIKFWDPRNKVVVGTFDQ-GKKVYCMDVS--GNRLVVGTS-D 154 (323)
T ss_pred EEecCCcce-eeccCCCceEEEEeeccCCeEEEcccCccEEEEecccccccccccc-CceEEEEecc--CCEEEEeec-C
Confidence 999988754 4556899999999998777777754 4599999997555544433 3467777664 557888777 9
Q ss_pred CeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 178 KHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 178 ~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
..+.+||+|... .......-.+.. ...+.+++ |++.-.++++-||+|.+=.+...
T Consensus 155 r~v~iyDLRn~~-~~~q~reS~lky---qtR~v~~~--pn~eGy~~sSieGRVavE~~d~s 209 (323)
T KOG1036|consen 155 RKVLIYDLRNLD-EPFQRRESSLKY---QTRCVALV--PNGEGYVVSSIEGRVAVEYFDDS 209 (323)
T ss_pred ceEEEEEccccc-chhhhcccccee---EEEEEEEe--cCCCceEEEeecceEEEEccCCc
Confidence 999999996322 211111111111 22222333 57777899999999998777664
No 128
>KOG1274 consensus WD40 repeat protein [General function prediction only]
Probab=99.84 E-value=3.8e-19 Score=159.07 Aligned_cols=198 Identities=13% Similarity=0.148 Sum_probs=157.6
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEE
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASE 99 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~ 99 (340)
+...|.+++.. +. +|++|+.+++|.+|....++....+.. ..-++++++|+.+|++++.||.|-.|++
T Consensus 55 ~g~~v~~ia~~--s~---------~f~~~s~~~tv~~y~fps~~~~~iL~R-ftlp~r~~~v~g~g~~iaagsdD~~vK~ 122 (933)
T KOG1274|consen 55 SGELVSSIACY--SN---------HFLTGSEQNTVLRYKFPSGEEDTILAR-FTLPIRDLAVSGSGKMIAAGSDDTAVKL 122 (933)
T ss_pred cCceeEEEeec--cc---------ceEEeeccceEEEeeCCCCCccceeee-eeccceEEEEecCCcEEEeecCceeEEE
Confidence 44556665553 44 699999999999999988875444444 5568999999999999999999999999
Q ss_pred EeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE--ecCcEEEEECCCCceeEEeecC--------CCCeEEEEECCCCCE
Q 036605 100 MKSEMGEVIREFKASEKPISSSAFLCEEKIFAL--ASSEVRILSLENGEEVLKFSDD--------VGPLQYVSASDGAKI 169 (340)
Q Consensus 100 wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~--~~~~i~i~d~~~~~~~~~~~~~--------~~~v~~~~~s~~~~~ 169 (340)
.+..+......+.+|..+|.++.++|.+.+||+ ++|.|++||+.++.....+.+- ...+..++|+|+|..
T Consensus 123 ~~~~D~s~~~~lrgh~apVl~l~~~p~~~fLAvss~dG~v~iw~~~~~~~~~tl~~v~k~n~~~~s~i~~~~aW~Pk~g~ 202 (933)
T KOG1274|consen 123 LNLDDSSQEKVLRGHDAPVLQLSYDPKGNFLAVSSCDGKVQIWDLQDGILSKTLTGVDKDNEFILSRICTRLAWHPKGGT 202 (933)
T ss_pred EeccccchheeecccCCceeeeeEcCCCCEEEEEecCceEEEEEcccchhhhhcccCCccccccccceeeeeeecCCCCe
Confidence 999999999999999999999999999999987 6677999999998766554321 345778999999878
Q ss_pred EEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCe-eeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 170 IITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPV-AIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 170 l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
++..+. |+.|.+|+. ...+....+. ..+... +..+ .| +|+|.|||+++.||.|.|||+.+
T Consensus 203 la~~~~-d~~Vkvy~r--~~we~~f~Lr--~~~~ss~~~~~--~w-sPnG~YiAAs~~~g~I~vWnv~t 263 (933)
T KOG1274|consen 203 LAVPPV-DNTVKVYSR--KGWELQFKLR--DKLSSSKFSDL--QW-SPNGKYIAASTLDGQILVWNVDT 263 (933)
T ss_pred EEeecc-CCeEEEEcc--CCceeheeec--ccccccceEEE--EE-cCCCcEEeeeccCCcEEEEeccc
Confidence 888788 999999997 4443333332 222222 3333 66 89999999999999999999996
No 129
>KOG0303 consensus Actin-binding protein Coronin, contains WD40 repeats [Cytoskeleton]
Probab=99.84 E-value=3.6e-19 Score=145.17 Aligned_cols=203 Identities=13% Similarity=0.143 Sum_probs=156.5
Q ss_pred CCCCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCe-------eEEEecCCCCCCeEEEEEecC-CCEE
Q 036605 18 GEPVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGE-------MKWKSTGRHPGGLAGLAFAKK-GRSL 88 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~-------~~~~~~~~h~~~v~~v~~~~~-~~~l 88 (340)
.+|..+|..++|+|.+ . .+|+|+.|.+|.||++..+. .+..+.+ |...|.-++|+|. .+.|
T Consensus 78 ~GHt~~vLDi~w~PfnD~---------vIASgSeD~~v~vW~IPe~~l~~~ltepvv~L~g-H~rrVg~V~wHPtA~NVL 147 (472)
T KOG0303|consen 78 CGHTAPVLDIDWCPFNDC---------VIASGSEDTKVMVWQIPENGLTRDLTEPVVELYG-HQRRVGLVQWHPTAPNVL 147 (472)
T ss_pred cCccccccccccCccCCc---------eeecCCCCceEEEEECCCcccccCcccceEEEee-cceeEEEEeecccchhhH
Confidence 6899999999999987 5 79999999999999987653 3456677 9999999999995 4689
Q ss_pred EEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCC-eEEEEECC
Q 036605 89 HVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGP-LQYVSASD 165 (340)
Q Consensus 89 ~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~-v~~~~~s~ 165 (340)
++++.|..|.+|++.+|+.+..+. |..-|+++.|+.+|..+++...+ |+|||.++++.+..-.+|.+. -..+.|-.
T Consensus 148 lsag~Dn~v~iWnv~tgeali~l~-hpd~i~S~sfn~dGs~l~TtckDKkvRv~dpr~~~~v~e~~~heG~k~~Raifl~ 226 (472)
T KOG0303|consen 148 LSAGSDNTVSIWNVGTGEALITLD-HPDMVYSMSFNRDGSLLCTTCKDKKVRVIDPRRGTVVSEGVAHEGAKPARAIFLA 226 (472)
T ss_pred hhccCCceEEEEeccCCceeeecC-CCCeEEEEEeccCCceeeeecccceeEEEcCCCCcEeeecccccCCCcceeEEec
Confidence 999999999999999999988887 99999999999999999986665 999999999988777777743 45577778
Q ss_pred CCCEEEEEEcC---CCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCC-EEEEEeCCCcEEEEECCCC
Q 036605 166 GAKIIITAGYG---EKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGT-VILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 166 ~~~~l~s~~~~---d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~l~~~s~dg~i~vwd~~~~ 238 (340)
++. ++++|.. ++++.+||-. .-+.. .....+.....++- ..+ .+|.. ..++|-.||.|+.|.+.+.
T Consensus 227 ~g~-i~tTGfsr~seRq~aLwdp~--nl~eP-~~~~elDtSnGvl~--PFy-D~dt~ivYl~GKGD~~IRYyEit~d 296 (472)
T KOG0303|consen 227 SGK-IFTTGFSRMSERQIALWDPN--NLEEP-IALQELDTSNGVLL--PFY-DPDTSIVYLCGKGDSSIRYFEITNE 296 (472)
T ss_pred cCc-eeeeccccccccceeccCcc--cccCc-ceeEEeccCCceEE--eee-cCCCCEEEEEecCCcceEEEEecCC
Confidence 887 6665543 7889999962 22111 11112222222221 244 45544 4577888999999988763
No 130
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=99.84 E-value=5.5e-18 Score=144.24 Aligned_cols=216 Identities=12% Similarity=0.087 Sum_probs=153.3
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEE-EcCCCcEEEEEccCCeeEEEecCCCCCCeEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLAL-GTSNGDILAVDVLTGEMKWKSTGRHPGGLAGL 79 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~-g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v 79 (340)
+||+.+++....+. .+ ..+..++|+|+++ .+++ +..++.|.+||+.+++.+..+.. ...+.++
T Consensus 57 ~~d~~~~~~~~~~~----~~-~~~~~~~~~~~g~---------~l~~~~~~~~~l~~~d~~~~~~~~~~~~--~~~~~~~ 120 (300)
T TIGR03866 57 VIDLATGEVIGTLP----SG-PDPELFALHPNGK---------ILYIANEDDNLVTVIDIETRKVLAEIPV--GVEPEGM 120 (300)
T ss_pred EEECCCCcEEEecc----CC-CCccEEEECCCCC---------EEEEEcCCCCeEEEEECCCCeEEeEeeC--CCCcceE
Confidence 57888888776655 22 2356789999997 5654 55689999999998887776653 3357889
Q ss_pred EEecCCCEEEEEeCCC-cEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEe---cCcEEEEECCCCceeEEeecCC
Q 036605 80 AFAKKGRSLHVVGTNG-MASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALA---SSEVRILSLENGEEVLKFSDDV 155 (340)
Q Consensus 80 ~~~~~~~~l~s~~~dg-~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~---~~~i~i~d~~~~~~~~~~~~~~ 155 (340)
+|+|++..+++++.++ .+.+||..+++....... ...+.+++|+|++++++++ ++.|++||+.+++.+..+..+.
T Consensus 121 ~~~~dg~~l~~~~~~~~~~~~~d~~~~~~~~~~~~-~~~~~~~~~s~dg~~l~~~~~~~~~v~i~d~~~~~~~~~~~~~~ 199 (300)
T TIGR03866 121 AVSPDGKIVVNTSETTNMAHFIDTKTYEIVDNVLV-DQRPRFAEFTADGKELWVSSEIGGTVSVIDVATRKVIKKITFEI 199 (300)
T ss_pred EECCCCCEEEEEecCCCeEEEEeCCCCeEEEEEEc-CCCccEEEECCCCCEEEEEcCCCCEEEEEEcCcceeeeeeeecc
Confidence 9999999999988775 567789988877655433 2345789999999988553 4459999999987776654221
Q ss_pred -------CCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEE-eCC
Q 036605 156 -------GPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAV-AES 227 (340)
Q Consensus 156 -------~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~-s~d 227 (340)
.....++|+|++++++.+...++.+.+||+ .+++..... ...+... .+ .| +|++.+|+++ ..+
T Consensus 200 ~~~~~~~~~~~~i~~s~dg~~~~~~~~~~~~i~v~d~--~~~~~~~~~--~~~~~~~--~~--~~-~~~g~~l~~~~~~~ 270 (300)
T TIGR03866 200 PGVHPEAVQPVGIKLTKDGKTAFVALGPANRVAVVDA--KTYEVLDYL--LVGQRVW--QL--AF-TPDEKYLLTTNGVS 270 (300)
T ss_pred cccccccCCccceEECCCCCEEEEEcCCCCeEEEEEC--CCCcEEEEE--EeCCCcc--eE--EE-CCCCCEEEEEcCCC
Confidence 123468899999987665444778999998 343332211 1233222 23 34 8999999876 468
Q ss_pred CcEEEEECCCCCccC
Q 036605 228 GVAYSWDLKTVSQDE 242 (340)
Q Consensus 228 g~i~vwd~~~~~~~~ 242 (340)
|.|.+||+.+++.+.
T Consensus 271 ~~i~v~d~~~~~~~~ 285 (300)
T TIGR03866 271 NDVSVIDVAALKVIK 285 (300)
T ss_pred CeEEEEECCCCcEEE
Confidence 999999999876554
No 131
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=99.82 E-value=4.9e-19 Score=147.07 Aligned_cols=219 Identities=14% Similarity=0.104 Sum_probs=168.0
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
+||++++++...-.+. +.....+.....||++. +|+..+..|.|++....+++.+..+. -.+.|..++
T Consensus 284 syDle~ak~~k~~~~~-g~e~~~~e~FeVShd~~---------fia~~G~~G~I~lLhakT~eli~s~K--ieG~v~~~~ 351 (514)
T KOG2055|consen 284 SYDLETAKVTKLKPPY-GVEEKSMERFEVSHDSN---------FIAIAGNNGHIHLLHAKTKELITSFK--IEGVVSDFT 351 (514)
T ss_pred EeeccccccccccCCC-CcccchhheeEecCCCC---------eEEEcccCceEEeehhhhhhhhheee--eccEEeeEE
Confidence 4888888766433322 33345677788899999 99999999999999999999888887 578999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCC-CeeEEEEccCCCEEEEecCc--EEEEECCC------CceeEEe
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEK-PISSSAFLCEEKIFALASSE--VRILSLEN------GEEVLKF 151 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~-~i~~l~~~~~~~~l~~~~~~--i~i~d~~~------~~~~~~~ 151 (340)
|+.|++.|+.++.+|.|.+||++....+++|....+ .-++++.++++.+||+|+.. |.|||..+ .+++..+
T Consensus 352 fsSdsk~l~~~~~~GeV~v~nl~~~~~~~rf~D~G~v~gts~~~S~ng~ylA~GS~~GiVNIYd~~s~~~s~~PkPik~~ 431 (514)
T KOG2055|consen 352 FSSDSKELLASGGTGEVYVWNLRQNSCLHRFVDDGSVHGTSLCISLNGSYLATGSDSGIVNIYDGNSCFASTNPKPIKTV 431 (514)
T ss_pred EecCCcEEEEEcCCceEEEEecCCcceEEEEeecCccceeeeeecCCCceEEeccCcceEEEeccchhhccCCCCchhhh
Confidence 999999999999999999999999988888874322 33678888999999998877 99999653 4566667
Q ss_pred ecCCCCeEEEEECCCCCEEEEEEcC-CCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcE
Q 036605 152 SDDVGPLQYVSASDGAKIIITAGYG-EKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVA 230 (340)
Q Consensus 152 ~~~~~~v~~~~~s~~~~~l~s~~~~-d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i 230 (340)
..-...|+++.|++|+..|+.++.. +..+++-.+ ++......+.........+..+ .| +|.+.+++.|..+|++
T Consensus 432 dNLtt~Itsl~Fn~d~qiLAiaS~~~knalrLVHv--PS~TVFsNfP~~n~~vg~vtc~--aF-SP~sG~lAvGNe~grv 506 (514)
T KOG2055|consen 432 DNLTTAITSLQFNHDAQILAIASRVKKNALRLVHV--PSCTVFSNFPTSNTKVGHVTCM--AF-SPNSGYLAVGNEAGRV 506 (514)
T ss_pred hhhheeeeeeeeCcchhhhhhhhhccccceEEEec--cceeeeccCCCCCCcccceEEE--Ee-cCCCceEEeecCCCce
Confidence 6677899999999999888765543 677888877 4433322222111111223333 45 8999999999999999
Q ss_pred EEEECC
Q 036605 231 YSWDLK 236 (340)
Q Consensus 231 ~vwd~~ 236 (340)
.+|.+.
T Consensus 507 ~l~kL~ 512 (514)
T KOG2055|consen 507 HLFKLH 512 (514)
T ss_pred eeEeec
Confidence 999875
No 132
>KOG0302 consensus Ribosome Assembly protein [General function prediction only]
Probab=99.82 E-value=1.2e-18 Score=141.34 Aligned_cols=204 Identities=16% Similarity=0.159 Sum_probs=151.3
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC----------------CeeEEEecCCCCCCeEEEEEec
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT----------------GEMKWKSTGRHPGGLAGLAFAK 83 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~----------------~~~~~~~~~~h~~~v~~v~~~~ 83 (340)
|.+.+..+.-++-+. ..+.|+-+..|.|+||++.. .+.+.++.+ |.+.=++++|||
T Consensus 150 h~g~~NRvr~~~~~~-------~~~~aswse~G~V~Vw~l~~~l~~l~~~~~~~~~s~~~Pl~t~~g-hk~EGy~LdWSp 221 (440)
T KOG0302|consen 150 HYGGINRVRVSRLGN-------EVLCASWSENGRVQVWDLAPHLNALSEPGLEVKDSEFRPLFTFNG-HKGEGYGLDWSP 221 (440)
T ss_pred cccccceeeecccCC-------cceeeeecccCcEEEEEchhhhhhhcCccccccccccCceEEecc-cCccceeeeccc
Confidence 444555555554431 23777788899999999642 235667777 998999999999
Q ss_pred C-CCEEEEEeCCCcEEEEeCCCCeEEE---EeecCCCCeeEEEEccCCCEE-EE--ecCcEEEEECCCCcee--EEeecC
Q 036605 84 K-GRSLHVVGTNGMASEMKSEMGEVIR---EFKASEKPISSSAFLCEEKIF-AL--ASSEVRILSLENGEEV--LKFSDD 154 (340)
Q Consensus 84 ~-~~~l~s~~~dg~i~~wd~~~~~~~~---~~~~~~~~i~~l~~~~~~~~l-~~--~~~~i~i~d~~~~~~~--~~~~~~ 154 (340)
- ...|++|..-+.|++|...+|.-.. .|.+|...|..|+|||...-+ ++ +++.|+|||++.+... ...+.|
T Consensus 222 ~~~g~LlsGDc~~~I~lw~~~~g~W~vd~~Pf~gH~~SVEDLqWSptE~~vfaScS~DgsIrIWDiRs~~~~~~~~~kAh 301 (440)
T KOG0302|consen 222 IKTGRLLSGDCVKGIHLWEPSTGSWKVDQRPFTGHTKSVEDLQWSPTEDGVFASCSCDGSIRIWDIRSGPKKAAVSTKAH 301 (440)
T ss_pred ccccccccCccccceEeeeeccCceeecCccccccccchhhhccCCccCceEEeeecCceEEEEEecCCCccceeEeecc
Confidence 3 2358888888999999998876432 366799999999999987654 44 5666999999988322 334889
Q ss_pred CCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCC-ccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEE
Q 036605 155 VGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKT-VNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSW 233 (340)
Q Consensus 155 ~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vw 233 (340)
.+.|+-+.|+..-.+|++++. ||+++|||+|.-+.. ....+. .|...+..+ -|...+...+++++.|.+|.+|
T Consensus 302 ~sDVNVISWnr~~~lLasG~D-dGt~~iwDLR~~~~~~pVA~fk---~Hk~pItsi--eW~p~e~s~iaasg~D~QitiW 375 (440)
T KOG0302|consen 302 NSDVNVISWNRREPLLASGGD-DGTLSIWDLRQFKSGQPVATFK---YHKAPITSI--EWHPHEDSVIAASGEDNQITIW 375 (440)
T ss_pred CCceeeEEccCCcceeeecCC-CceEEEEEhhhccCCCcceeEE---eccCCeeEE--EeccccCceEEeccCCCcEEEE
Confidence 999999999998888888777 999999999744322 222333 566666666 6644566788899999999999
Q ss_pred ECCC
Q 036605 234 DLKT 237 (340)
Q Consensus 234 d~~~ 237 (340)
|+..
T Consensus 376 Dlsv 379 (440)
T KOG0302|consen 376 DLSV 379 (440)
T ss_pred Eeec
Confidence 9876
No 133
>KOG1274 consensus WD40 repeat protein [General function prediction only]
Probab=99.82 E-value=7.9e-18 Score=150.75 Aligned_cols=212 Identities=13% Similarity=0.088 Sum_probs=169.1
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCC-eeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTG-EMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMA 97 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~-~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i 97 (340)
.|....+.++|.|+|. +|++++.||.|++|+.... +....+.. +...|.+++.. +.+|++|+.++.|
T Consensus 11 aht~G~t~i~~d~~ge---------fi~tcgsdg~ir~~~~~sd~e~P~ti~~-~g~~v~~ia~~--s~~f~~~s~~~tv 78 (933)
T KOG1274|consen 11 AHTGGLTLICYDPDGE---------FICTCGSDGDIRKWKTNSDEEEPETIDI-SGELVSSIACY--SNHFLTGSEQNTV 78 (933)
T ss_pred hccCceEEEEEcCCCC---------EEEEecCCCceEEeecCCcccCCchhhc-cCceeEEEeec--ccceEEeeccceE
Confidence 5777899999999999 9999999999999997655 33334443 66778887754 6699999999999
Q ss_pred EEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEc
Q 036605 98 SEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGY 175 (340)
Q Consensus 98 ~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~ 175 (340)
.+|.+..++.-..+....-++.+++|+.+|.+++.|+.+ |++.++.+......+.+|.++|.++.|+|.+.+|+++..
T Consensus 79 ~~y~fps~~~~~iL~Rftlp~r~~~v~g~g~~iaagsdD~~vK~~~~~D~s~~~~lrgh~apVl~l~~~p~~~fLAvss~ 158 (933)
T KOG1274|consen 79 LRYKFPSGEEDTILARFTLPIRDLAVSGSGKMIAAGSDDTAVKLLNLDDSSQEKVLRGHDAPVLQLSYDPKGNFLAVSSC 158 (933)
T ss_pred EEeeCCCCCccceeeeeeccceEEEEecCCcEEEeecCceeEEEEeccccchheeecccCCceeeeeEcCCCCEEEEEec
Confidence 999999887655555566789999999999999998877 999999998888999999999999999999999999877
Q ss_pred CCCeEEEEEccCCCCCccCCceeee---cCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCC
Q 036605 176 GEKHLQVWRCDISSKTVNKGPALSM---RHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 176 ~d~~i~iwd~~~~~~~~~~~~~~~~---~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p 246 (340)
||.|+||++ ..+.....+.... +...........| +|++..+++.+.|+.|.+|+....+....+.+
T Consensus 159 -dG~v~iw~~--~~~~~~~tl~~v~k~n~~~~s~i~~~~aW-~Pk~g~la~~~~d~~Vkvy~r~~we~~f~Lr~ 228 (933)
T KOG1274|consen 159 -DGKVQIWDL--QDGILSKTLTGVDKDNEFILSRICTRLAW-HPKGGTLAVPPVDNTVKVYSRKGWELQFKLRD 228 (933)
T ss_pred -CceEEEEEc--ccchhhhhcccCCccccccccceeeeeee-cCCCCeEEeeccCCeEEEEccCCceeheeecc
Confidence 999999999 4544333222110 1111122233477 89988899999999999999999877766665
No 134
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=99.82 E-value=2.3e-18 Score=143.08 Aligned_cols=206 Identities=14% Similarity=0.141 Sum_probs=157.9
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe--eEEEecCCCCCCeEEEEEecCCC-EEEEEeCCCcEE
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE--MKWKSTGRHPGGLAGLAFAKKGR-SLHVVGTNGMAS 98 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~--~~~~~~~~h~~~v~~v~~~~~~~-~l~s~~~dg~i~ 98 (340)
+.|+|+.|+|... +|++++.||+++||.+.... .++.+.- ...+|.+.+|.|+|. .+++++....++
T Consensus 214 ~~I~sv~FHp~~p---------lllvaG~d~~lrifqvDGk~N~~lqS~~l-~~fPi~~a~f~p~G~~~i~~s~rrky~y 283 (514)
T KOG2055|consen 214 GGITSVQFHPTAP---------LLLVAGLDGTLRIFQVDGKVNPKLQSIHL-EKFPIQKAEFAPNGHSVIFTSGRRKYLY 283 (514)
T ss_pred CCceEEEecCCCc---------eEEEecCCCcEEEEEecCccChhheeeee-ccCccceeeecCCCceEEEecccceEEE
Confidence 7899999999988 99999999999999886432 3334333 456899999999999 899999999999
Q ss_pred EEeCCCCeEEEE--eecC-CCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEE
Q 036605 99 EMKSEMGEVIRE--FKAS-EKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITA 173 (340)
Q Consensus 99 ~wd~~~~~~~~~--~~~~-~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~ 173 (340)
.||+.+++.... ..++ ...+....++|++++++.++.. |.+....+++.+..++ ..+.|..+.|+.+++.|+++
T Consensus 284 syDle~ak~~k~~~~~g~e~~~~e~FeVShd~~fia~~G~~G~I~lLhakT~eli~s~K-ieG~v~~~~fsSdsk~l~~~ 362 (514)
T KOG2055|consen 284 SYDLETAKVTKLKPPYGVEEKSMERFEVSHDSNFIAIAGNNGHIHLLHAKTKELITSFK-IEGVVSDFTFSSDSKELLAS 362 (514)
T ss_pred EeeccccccccccCCCCcccchhheeEecCCCCeEEEcccCceEEeehhhhhhhhheee-eccEEeeEEEecCCcEEEEE
Confidence 999998875432 2222 3357788999999999997776 8888888998887776 36789999999999999998
Q ss_pred EcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCC
Q 036605 174 GYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 174 ~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p 246 (340)
+. +|.|.+||++.. .....+. ....+.....+. +.++.+|++|+..|.|.|||..+...-...+|
T Consensus 363 ~~-~GeV~v~nl~~~--~~~~rf~----D~G~v~gts~~~-S~ng~ylA~GS~~GiVNIYd~~s~~~s~~PkP 427 (514)
T KOG2055|consen 363 GG-TGEVYVWNLRQN--SCLHRFV----DDGSVHGTSLCI-SLNGSYLATGSDSGIVNIYDGNSCFASTNPKP 427 (514)
T ss_pred cC-CceEEEEecCCc--ceEEEEe----ecCccceeeeee-cCCCceEEeccCcceEEEeccchhhccCCCCc
Confidence 87 999999999532 2222222 222222222233 78999999999999999999887554444555
No 135
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=99.82 E-value=8.4e-18 Score=145.91 Aligned_cols=206 Identities=16% Similarity=0.140 Sum_probs=158.2
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeE-EEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEE
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMK-WKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASE 99 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~-~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~ 99 (340)
..+|+||||+...+ .||++-.+|.|-||++..+-.. ..+.+.....|-+++|+ ++..|++.+.+|.|.-
T Consensus 25 Ps~I~slA~s~kS~---------~lAvsRt~g~IEiwN~~~~w~~~~vi~g~~drsIE~L~W~-e~~RLFS~g~sg~i~E 94 (691)
T KOG2048|consen 25 PSEIVSLAYSHKSN---------QLAVSRTDGNIEIWNLSNNWFLEPVIHGPEDRSIESLAWA-EGGRLFSSGLSGSITE 94 (691)
T ss_pred ccceEEEEEeccCC---------ceeeeccCCcEEEEccCCCceeeEEEecCCCCceeeEEEc-cCCeEEeecCCceEEE
Confidence 35899999998887 7999999999999999886533 34455456789999999 5778999999999999
Q ss_pred EeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCcee--EEeecCCCCeEEEEECCCCCEEEEEEc
Q 036605 100 MKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEV--LKFSDDVGPLQYVSASDGAKIIITAGY 175 (340)
Q Consensus 100 wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~--~~~~~~~~~v~~~~~s~~~~~l~s~~~ 175 (340)
||+.+++.+..+....+.|++++.+|.+..++.+..+ ++.++...++.. ..|.-..+.+.++.|+|++..++.|+.
T Consensus 95 wDl~~lk~~~~~d~~gg~IWsiai~p~~~~l~IgcddGvl~~~s~~p~~I~~~r~l~rq~sRvLslsw~~~~~~i~~Gs~ 174 (691)
T KOG2048|consen 95 WDLHTLKQKYNIDSNGGAIWSIAINPENTILAIGCDDGVLYDFSIGPDKITYKRSLMRQKSRVLSLSWNPTGTKIAGGSI 174 (691)
T ss_pred EecccCceeEEecCCCcceeEEEeCCccceEEeecCCceEEEEecCCceEEEEeecccccceEEEEEecCCccEEEeccc
Confidence 9999999999999989999999999999999886333 666666666544 233444588999999999999999888
Q ss_pred CCCeEEEEEccCCCCCccCCcee-----eecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCC
Q 036605 176 GEKHLQVWRCDISSKTVNKGPAL-----SMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEK 243 (340)
Q Consensus 176 ~d~~i~iwd~~~~~~~~~~~~~~-----~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~ 243 (340)
||.|++||. ..+........ .-..+..++.+ .+ -....+++|.+.|.|.+||...+.++..
T Consensus 175 -Dg~Iriwd~--~~~~t~~~~~~~~d~l~k~~~~iVWSv--~~--Lrd~tI~sgDS~G~V~FWd~~~gTLiqS 240 (691)
T KOG2048|consen 175 -DGVIRIWDV--KSGQTLHIITMQLDRLSKREPTIVWSV--LF--LRDSTIASGDSAGTVTFWDSIFGTLIQS 240 (691)
T ss_pred -CceEEEEEc--CCCceEEEeeecccccccCCceEEEEE--EE--eecCcEEEecCCceEEEEcccCcchhhh
Confidence 999999998 44433331111 11122333443 23 2335699999999999999998766653
No 136
>KOG1273 consensus WD40 repeat protein [General function prediction only]
Probab=99.81 E-value=1.9e-18 Score=137.28 Aligned_cols=218 Identities=15% Similarity=0.178 Sum_probs=158.0
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCe----
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGL---- 76 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v---- 76 (340)
|||..+-..-..+. .|..+|+|++||++|+ .|++++.|..|.+||+..|.+++++. ..++|
T Consensus 49 I~D~~T~~iar~ls----aH~~pi~sl~WS~dgr---------~LltsS~D~si~lwDl~~gs~l~rir--f~spv~~~q 113 (405)
T KOG1273|consen 49 IYDFDTFRIARMLS----AHVRPITSLCWSRDGR---------KLLTSSRDWSIKLWDLLKGSPLKRIR--FDSPVWGAQ 113 (405)
T ss_pred EEEccccchhhhhh----ccccceeEEEecCCCC---------EeeeecCCceeEEEeccCCCceeEEE--ccCccceee
Confidence 46666555445554 8999999999999999 89999999999999999888766552 11111
Q ss_pred -------------------------------------------EEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeec
Q 036605 77 -------------------------------------------AGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKA 113 (340)
Q Consensus 77 -------------------------------------------~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~ 113 (340)
.+..|.+.|+++++|...|.+.++|..+.+.+..++.
T Consensus 114 ~hp~k~n~~va~~~~~sp~vi~~s~~~h~~Lp~d~d~dln~sas~~~fdr~g~yIitGtsKGkllv~~a~t~e~vas~ri 193 (405)
T KOG1273|consen 114 WHPRKRNKCVATIMEESPVVIDFSDPKHSVLPKDDDGDLNSSASHGVFDRRGKYIITGTSKGKLLVYDAETLECVASFRI 193 (405)
T ss_pred eccccCCeEEEEEecCCcEEEEecCCceeeccCCCccccccccccccccCCCCEEEEecCcceEEEEecchheeeeeeee
Confidence 1123566688999999999999999999998888776
Q ss_pred CC-CCeeEEEEccCCCEEEE--ecCcEEEEECCCC-------ce--eEEeec--CCCCeEEEEECCCCCEEEEEEcCCCe
Q 036605 114 SE-KPISSSAFLCEEKIFAL--ASSEVRILSLENG-------EE--VLKFSD--DVGPLQYVSASDGAKIIITAGYGEKH 179 (340)
Q Consensus 114 ~~-~~i~~l~~~~~~~~l~~--~~~~i~i~d~~~~-------~~--~~~~~~--~~~~v~~~~~s~~~~~l~s~~~~d~~ 179 (340)
.. ..|.++.++..|+.++. .++.|+.|+++.- +. ..++.. ....-.+++|+.+|.|+++++.....
T Consensus 194 ts~~~IK~I~~s~~g~~liiNtsDRvIR~ye~~di~~~~r~~e~e~~~K~qDvVNk~~Wk~ccfs~dgeYv~a~s~~aHa 273 (405)
T KOG1273|consen 194 TSVQAIKQIIVSRKGRFLIINTSDRVIRTYEISDIDDEGRDGEVEPEHKLQDVVNKLQWKKCCFSGDGEYVCAGSARAHA 273 (405)
T ss_pred chheeeeEEEEeccCcEEEEecCCceEEEEehhhhcccCccCCcChhHHHHHHHhhhhhhheeecCCccEEEecccccee
Confidence 65 67889999999999987 5555999998621 11 122211 12344678999999999998877888
Q ss_pred EEEEEccCCCCCccCCceeeecCC-CeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 180 LQVWRCDISSKTVNKGPALSMRHS-PVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 180 i~iwd~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
++||.- ..+...+.+. +.. ....++ .| +|-...+++. ..|.+++|.......-.
T Consensus 274 LYIWE~--~~GsLVKILh---G~kgE~l~DV--~w-hp~rp~i~si-~sg~v~iw~~~~~enws 328 (405)
T KOG1273|consen 274 LYIWEK--SIGSLVKILH---GTKGEELLDV--NW-HPVRPIIASI-ASGVVYIWAVVQVENWS 328 (405)
T ss_pred EEEEec--CCcceeeeec---CCchhheeec--cc-ccceeeeeec-cCCceEEEEeecccchh
Confidence 999996 4565555544 333 344555 55 6666667766 77889999876544333
No 137
>KOG0647 consensus mRNA export protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.81 E-value=4.5e-18 Score=134.31 Aligned_cols=200 Identities=14% Similarity=0.176 Sum_probs=133.4
Q ss_pred CccCCC-CceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEE
Q 036605 1 IWSTND-GSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGL 79 (340)
Q Consensus 1 vwd~~~-g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v 79 (340)
+|+++. |+....-. ..|..+|.|++|+.||. .+++|+.|+.+++||+.+++ ...+.. |.++|.++
T Consensus 54 ~wevq~~g~~~~ka~---~~~~~PvL~v~Wsddgs---------kVf~g~~Dk~~k~wDL~S~Q-~~~v~~-Hd~pvkt~ 119 (347)
T KOG0647|consen 54 IWEVQNSGQLVPKAQ---QSHDGPVLDVCWSDDGS---------KVFSGGCDKQAKLWDLASGQ-VSQVAA-HDAPVKTC 119 (347)
T ss_pred EEEEecCCcccchhh---hccCCCeEEEEEccCCc---------eEEeeccCCceEEEEccCCC-eeeeee-cccceeEE
Confidence 466654 45443222 25889999999999997 79999999999999999995 445665 99999999
Q ss_pred EEecCCC--EEEEEeCCCcEEEEeCCCCeEEEEeecC-----------------------------------------CC
Q 036605 80 AFAKKGR--SLHVVGTNGMASEMKSEMGEVIREFKAS-----------------------------------------EK 116 (340)
Q Consensus 80 ~~~~~~~--~l~s~~~dg~i~~wd~~~~~~~~~~~~~-----------------------------------------~~ 116 (340)
.|-+... .|++|+.|.+|+.||.+...++..+... +.
T Consensus 120 ~wv~~~~~~cl~TGSWDKTlKfWD~R~~~pv~t~~LPeRvYa~Dv~~pm~vVata~r~i~vynL~n~~te~k~~~SpLk~ 199 (347)
T KOG0647|consen 120 HWVPGMNYQCLVTGSWDKTLKFWDTRSSNPVATLQLPERVYAADVLYPMAVVATAERHIAVYNLENPPTEFKRIESPLKW 199 (347)
T ss_pred EEecCCCcceeEecccccceeecccCCCCeeeeeeccceeeehhccCceeEEEecCCcEEEEEcCCCcchhhhhcCcccc
Confidence 9987665 8999999999999999987665544321 11
Q ss_pred CeeEEEEccCCCEEEEe--cCcEEEEECCCC--ceeEEeecCC---------CCeEEEEECCCCCEEEEEEcCCCeEEEE
Q 036605 117 PISSSAFLCEEKIFALA--SSEVRILSLENG--EEVLKFSDDV---------GPLQYVSASDGAKIIITAGYGEKHLQVW 183 (340)
Q Consensus 117 ~i~~l~~~~~~~~l~~~--~~~i~i~d~~~~--~~~~~~~~~~---------~~v~~~~~s~~~~~l~s~~~~d~~i~iw 183 (340)
.+.||+..++....+.+ .+.+.+..+..+ +.-..|+-|. ..|.+++|+|....|+++|+ ||++.+|
T Consensus 200 Q~R~va~f~d~~~~alGsiEGrv~iq~id~~~~~~nFtFkCHR~~~~~~~~VYaVNsi~FhP~hgtlvTaGs-DGtf~FW 278 (347)
T KOG0647|consen 200 QTRCVACFQDKDGFALGSIEGRVAIQYIDDPNPKDNFTFKCHRSTNSVNDDVYAVNSIAFHPVHGTLVTAGS-DGTFSFW 278 (347)
T ss_pred eeeEEEEEecCCceEeeeecceEEEEecCCCCccCceeEEEeccCCCCCCceEEecceEeecccceEEEecC-CceEEEe
Confidence 23445544444333332 233444444333 2224444454 35788999999889999999 9999999
Q ss_pred EccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEE
Q 036605 184 RCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILA 223 (340)
Q Consensus 184 d~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~ 223 (340)
|-+ ....+.... .++..+..+ .| +.+|.+++-
T Consensus 279 Dkd--ar~kLk~s~---~~~qpItcc--~f-n~~G~ifaY 310 (347)
T KOG0647|consen 279 DKD--ARTKLKTSE---THPQPITCC--SF-NRNGSIFAY 310 (347)
T ss_pred cch--hhhhhhccC---cCCCcccee--Ee-cCCCCEEEE
Confidence 973 333333322 333333333 44 555555543
No 138
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=99.81 E-value=1.9e-17 Score=143.80 Aligned_cols=215 Identities=14% Similarity=0.176 Sum_probs=168.5
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
||++..+-.+...-. ++.+..|..++|++.++ |++.+-+|.|.-||+.+++....+.. ..+.|++++
T Consensus 51 iwN~~~~w~~~~vi~--g~~drsIE~L~W~e~~R----------LFS~g~sg~i~EwDl~~lk~~~~~d~-~gg~IWsia 117 (691)
T KOG2048|consen 51 IWNLSNNWFLEPVIH--GPEDRSIESLAWAEGGR----------LFSSGLSGSITEWDLHTLKQKYNIDS-NGGAIWSIA 117 (691)
T ss_pred EEccCCCceeeEEEe--cCCCCceeeEEEccCCe----------EEeecCCceEEEEecccCceeEEecC-CCcceeEEE
Confidence 688888776643332 36678999999998778 88888999999999999999988887 888999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEEE--eecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEee----
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIRE--FKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFS---- 152 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~--~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~---- 152 (340)
.+|.+..++.|+.||.+..++...++.... +...++.+.+++|+|++..+++|..+ |++||..++..+....
T Consensus 118 i~p~~~~l~IgcddGvl~~~s~~p~~I~~~r~l~rq~sRvLslsw~~~~~~i~~Gs~Dg~Iriwd~~~~~t~~~~~~~~d 197 (691)
T KOG2048|consen 118 INPENTILAIGCDDGVLYDFSIGPDKITYKRSLMRQKSRVLSLSWNPTGTKIAGGSIDGVIRIWDVKSGQTLHIITMQLD 197 (691)
T ss_pred eCCccceEEeecCCceEEEEecCCceEEEEeecccccceEEEEEecCCccEEEecccCceEEEEEcCCCceEEEeeeccc
Confidence 999999999999999888888887775543 44556889999999999988886554 9999999987765221
Q ss_pred ----cCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCC
Q 036605 153 ----DDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESG 228 (340)
Q Consensus 153 ----~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg 228 (340)
....-|+++.|-.++ .|+++.+ .|+|.+||. ..+.+..... .|..-+..+ .. .+++.++++++.|+
T Consensus 198 ~l~k~~~~iVWSv~~Lrd~-tI~sgDS-~G~V~FWd~--~~gTLiqS~~---~h~adVl~L--av-~~~~d~vfsaGvd~ 267 (691)
T KOG2048|consen 198 RLSKREPTIVWSVLFLRDS-TIASGDS-AGTVTFWDS--IFGTLIQSHS---CHDADVLAL--AV-ADNEDRVFSAGVDP 267 (691)
T ss_pred ccccCCceEEEEEEEeecC-cEEEecC-CceEEEEcc--cCcchhhhhh---hhhcceeEE--EE-cCCCCeEEEccCCC
Confidence 123457888888666 6777666 999999998 4555555444 444444444 33 67788999999999
Q ss_pred cEEEEECCCC
Q 036605 229 VAYSWDLKTV 238 (340)
Q Consensus 229 ~i~vwd~~~~ 238 (340)
.|..|...+.
T Consensus 268 ~ii~~~~~~~ 277 (691)
T KOG2048|consen 268 KIIQYSLTTN 277 (691)
T ss_pred ceEEEEecCC
Confidence 9999987764
No 139
>KOG1408 consensus WD40 repeat protein [Function unknown]
Probab=99.81 E-value=4.6e-18 Score=148.52 Aligned_cols=209 Identities=13% Similarity=0.175 Sum_probs=164.8
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEec---CCCEEEEEeCCCcEE
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAK---KGRSLHVVGTNGMAS 98 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~---~~~~l~s~~~dg~i~ 98 (340)
..+.|++.||+++ +||+|..-|+++||++..-+....+.. |...|.|+.|+. ..++|++++.|..|.
T Consensus 460 ~G~R~~~vSp~gq---------hLAsGDr~GnlrVy~Lq~l~~~~~~eA-HesEilcLeyS~p~~~~kLLASasrdRlIH 529 (1080)
T KOG1408|consen 460 FGFRALAVSPDGQ---------HLASGDRGGNLRVYDLQELEYTCFMEA-HESEILCLEYSFPVLTNKLLASASRDRLIH 529 (1080)
T ss_pred cceEEEEECCCcc---------eecccCccCceEEEEehhhhhhhheec-ccceeEEEeecCchhhhHhhhhccCCceEE
Confidence 4689999999999 999999999999999999888888887 999999999985 346899999999999
Q ss_pred EEeCCCC-eEEEEeecCCCCeeEEEEccCC--CEEEEecCc-EEEEECCC-CceeEEeecC-----CCCeEEEEECCCCC
Q 036605 99 EMKSEMG-EVIREFKASEKPISSSAFLCEE--KIFALASSE-VRILSLEN-GEEVLKFSDD-----VGPLQYVSASDGAK 168 (340)
Q Consensus 99 ~wd~~~~-~~~~~~~~~~~~i~~l~~~~~~--~~l~~~~~~-i~i~d~~~-~~~~~~~~~~-----~~~v~~~~~s~~~~ 168 (340)
+||+... .++.++.+|...|+++.|.-.| ..+++++.+ ..+|+... ......|..| ...+..|+..|..+
T Consensus 530 V~Dv~rny~l~qtld~HSssITsvKFa~~gln~~MiscGADksimFr~~qk~~~g~~f~r~t~t~~ktTlYDm~Vdp~~k 609 (1080)
T KOG1408|consen 530 VYDVKRNYDLVQTLDGHSSSITSVKFACNGLNRKMISCGADKSIMFRVNQKASSGRLFPRHTQTLSKTTLYDMAVDPTSK 609 (1080)
T ss_pred EEecccccchhhhhcccccceeEEEEeecCCceEEEeccCchhhheehhccccCceeccccccccccceEEEeeeCCCcc
Confidence 9998643 4567788999999999998877 445554444 33444332 1111223222 35688999999999
Q ss_pred EEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCC
Q 036605 169 IIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 169 ~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p 246 (340)
++++++. |+.|+||++ ..+++.+.+.-...|....+.+ .. .|.|.|+++.+.|.++.++|+.+++.+.....
T Consensus 610 ~v~t~cQ-Drnirif~i--~sgKq~k~FKgs~~~eG~lIKv--~l-DPSgiY~atScsdktl~~~Df~sgEcvA~m~G 681 (1080)
T KOG1408|consen 610 LVVTVCQ-DRNIRIFDI--ESGKQVKSFKGSRDHEGDLIKV--IL-DPSGIYLATSCSDKTLCFVDFVSGECVAQMTG 681 (1080)
T ss_pred eEEEEec-ccceEEEec--cccceeeeecccccCCCceEEE--EE-CCCccEEEEeecCCceEEEEeccchhhhhhcC
Confidence 9999888 999999999 6777767666555665555555 44 79999999999999999999999887764433
No 140
>KOG0307 consensus Vesicle coat complex COPII, subunit SEC31 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.81 E-value=9.9e-20 Score=166.38 Aligned_cols=204 Identities=15% Similarity=0.179 Sum_probs=162.7
Q ss_pred CCCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCeeEEEecC-CCCCCeEEEEEecCC-CEEEEEeCCC
Q 036605 19 EPVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTG-RHPGGLAGLAFAKKG-RSLHVVGTNG 95 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~-~h~~~v~~v~~~~~~-~~l~s~~~dg 95 (340)
.|.+.|..+.|++.+ . +||+|++||.|.|||+.+.+....+.. ...+.|.+++|+..- ..|++++.+|
T Consensus 114 ~h~G~V~gLDfN~~q~n---------lLASGa~~geI~iWDlnn~~tP~~~~~~~~~~eI~~lsWNrkvqhILAS~s~sg 184 (1049)
T KOG0307|consen 114 KHTGPVLGLDFNPFQGN---------LLASGADDGEILIWDLNKPETPFTPGSQAPPSEIKCLSWNRKVSHILASGSPSG 184 (1049)
T ss_pred ccCCceeeeeccccCCc---------eeeccCCCCcEEEeccCCcCCCCCCCCCCCcccceEeccchhhhHHhhccCCCC
Confidence 799999999999987 5 999999999999999988654444422 256789999998754 4688888999
Q ss_pred cEEEEeCCCCeEEEEeecCCC--CeeEEEEccCCCE-EEEecCc-----EEEEECCCCc-eeEEeecCCCCeEEEEECCC
Q 036605 96 MASEMKSEMGEVIREFKASEK--PISSSAFLCEEKI-FALASSE-----VRILSLENGE-EVLKFSDDVGPLQYVSASDG 166 (340)
Q Consensus 96 ~i~~wd~~~~~~~~~~~~~~~--~i~~l~~~~~~~~-l~~~~~~-----i~i~d~~~~~-~~~~~~~~~~~v~~~~~s~~ 166 (340)
.+.+||++..+.+..+..+.. .++.++|+|+... ++++.++ |.+||++.-. .++.+.+|...|.++.|++.
T Consensus 185 ~~~iWDlr~~~pii~ls~~~~~~~~S~l~WhP~~aTql~~As~dd~~PviqlWDlR~assP~k~~~~H~~GilslsWc~~ 264 (1049)
T KOG0307|consen 185 RAVIWDLRKKKPIIKLSDTPGRMHCSVLAWHPDHATQLLVASGDDSAPVIQLWDLRFASSPLKILEGHQRGILSLSWCPQ 264 (1049)
T ss_pred CceeccccCCCcccccccCCCccceeeeeeCCCCceeeeeecCCCCCceeEeecccccCCchhhhcccccceeeeccCCC
Confidence 999999999888877765544 4779999998743 3333333 9999998643 45777899999999999887
Q ss_pred C-CEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCC
Q 036605 167 A-KIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVS 239 (340)
Q Consensus 167 ~-~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~ 239 (340)
+ .++++++. |+.|.+|+. ++++.+..+. ....+.+++ .|...+...+++++-||.|.||.+....
T Consensus 265 D~~lllSsgk-D~~ii~wN~--~tgEvl~~~p---~~~nW~fdv--~w~pr~P~~~A~asfdgkI~I~sl~~~~ 330 (1049)
T KOG0307|consen 265 DPRLLLSSGK-DNRIICWNP--NTGEVLGELP---AQGNWCFDV--QWCPRNPSVMAAASFDGKISIYSLQGTD 330 (1049)
T ss_pred CchhhhcccC-CCCeeEecC--CCceEeeecC---CCCcceeee--eecCCCcchhhhheeccceeeeeeecCC
Confidence 6 77788777 999999998 6777766665 456778888 6755666689999999999999998754
No 141
>KOG0650 consensus WD40 repeat nucleolar protein Bop1, involved in ribosome biogenesis [Translation, ribosomal structure and biogenesis]
Probab=99.80 E-value=5.9e-18 Score=145.00 Aligned_cols=201 Identities=16% Similarity=0.163 Sum_probs=149.2
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCC--EEEEEeCC--
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGR--SLHVVGTN-- 94 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~--~l~s~~~d-- 94 (340)
+|++.|.|+...|.|. +|++|+.||+|+||.+.+|++++++. ..+.|.||+|+|.+. .|+++-..
T Consensus 398 GHtg~Vr~iSvdp~G~---------wlasGsdDGtvriWEi~TgRcvr~~~--~d~~I~~vaw~P~~~~~vLAvA~~~~~ 466 (733)
T KOG0650|consen 398 GHTGLVRSISVDPSGE---------WLASGSDDGTVRIWEIATGRCVRTVQ--FDSEIRSVAWNPLSDLCVLAVAVGECV 466 (733)
T ss_pred ccCCeEEEEEecCCcc---------eeeecCCCCcEEEEEeecceEEEEEe--ecceeEEEEecCCCCceeEEEEecCce
Confidence 8999999999999999 99999999999999999999988876 456778888877554 22221111
Q ss_pred ------------------------------CcEEEEeC------------------------------------------
Q 036605 95 ------------------------------GMASEMKS------------------------------------------ 102 (340)
Q Consensus 95 ------------------------------g~i~~wd~------------------------------------------ 102 (340)
+.+..|.-
T Consensus 467 ~ivnp~~G~~~e~~~t~ell~~~~~~~~p~~~~~~W~~~~~~e~~~~v~~~I~~~k~i~~vtWHrkGDYlatV~~~~~~~ 546 (733)
T KOG0650|consen 467 LIVNPIFGDRLEVGPTKELLASAPNESEPDAAVVTWSRASLDELEKGVCIVIKHPKSIRQVTWHRKGDYLATVMPDSGNK 546 (733)
T ss_pred EEeCccccchhhhcchhhhhhcCCCccCCcccceeechhhhhhhccceEEEEecCCccceeeeecCCceEEEeccCCCcc
Confidence 11223321
Q ss_pred -------CCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc-EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEE
Q 036605 103 -------EMGEVIREFKASEKPISSSAFLCEEKIFALASSE-VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAG 174 (340)
Q Consensus 103 -------~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~-i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~ 174 (340)
.......-|....+.+.++.|+|...+|+++... |++||+.....+.++......|..++.+|.|..|+.++
T Consensus 547 ~VliHQLSK~~sQ~PF~kskG~vq~v~FHPs~p~lfVaTq~~vRiYdL~kqelvKkL~tg~kwiS~msihp~GDnli~gs 626 (733)
T KOG0650|consen 547 SVLIHQLSKRKSQSPFRKSKGLVQRVKFHPSKPYLFVATQRSVRIYDLSKQELVKKLLTGSKWISSMSIHPNGDNLILGS 626 (733)
T ss_pred eEEEEecccccccCchhhcCCceeEEEecCCCceEEEEeccceEEEehhHHHHHHHHhcCCeeeeeeeecCCCCeEEEec
Confidence 1111111122335568899999999888776555 99999999887777766678899999999999999988
Q ss_pred cCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 175 YGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 175 ~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
. |+.+..||++..++. ...+. .|...+..+ ++ ++.-.++++|+.||.+.||...-.
T Consensus 627 ~-d~k~~WfDldlsskP-yk~lr---~H~~avr~V--a~-H~ryPLfas~sdDgtv~Vfhg~VY 682 (733)
T KOG0650|consen 627 Y-DKKMCWFDLDLSSKP-YKTLR---LHEKAVRSV--AF-HKRYPLFASGSDDGTVIVFHGMVY 682 (733)
T ss_pred C-CCeeEEEEcccCcch-hHHhh---hhhhhhhhh--hh-ccccceeeeecCCCcEEEEeeeee
Confidence 8 999999999755432 22222 566666666 66 788889999999999999976543
No 142
>KOG1188 consensus WD40 repeat protein [General function prediction only]
Probab=99.80 E-value=4.1e-18 Score=136.68 Aligned_cols=193 Identities=11% Similarity=0.155 Sum_probs=144.9
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEec--CCCEEEEEeCCCcEEEEeCCCCeEEEE--eecCC-CCe
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAK--KGRSLHVVGTNGMASEMKSEMGEVIRE--FKASE-KPI 118 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~--~~~~l~s~~~dg~i~~wd~~~~~~~~~--~~~~~-~~i 118 (340)
.+|++..+|.|++||..+++.+..+.+ ++..++.++|.. ....+++|+.||.|++||++....... +..+. .+.
T Consensus 42 ~vav~lSngsv~lyd~~tg~~l~~fk~-~~~~~N~vrf~~~ds~h~v~s~ssDG~Vr~wD~Rs~~e~a~~~~~~~~~~~f 120 (376)
T KOG1188|consen 42 AVAVSLSNGSVRLYDKGTGQLLEEFKG-PPATTNGVRFISCDSPHGVISCSSDGTVRLWDIRSQAESARISWTQQSGTPF 120 (376)
T ss_pred eEEEEecCCeEEEEeccchhhhheecC-CCCcccceEEecCCCCCeeEEeccCCeEEEEEeecchhhhheeccCCCCCcc
Confidence 699999999999999999999999998 999999999987 456899999999999999998765444 44444 466
Q ss_pred eEEEEccCCCEEEEecCc------EEEEECCCCce-eEEe-ecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCC
Q 036605 119 SSSAFLCEEKIFALASSE------VRILSLENGEE-VLKF-SDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSK 190 (340)
Q Consensus 119 ~~l~~~~~~~~l~~~~~~------i~i~d~~~~~~-~~~~-~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~ 190 (340)
.+++..-.++.++++... |.+||++..+. +..+ ..|...|+++.|+|...-++.+|+-||.|.|||+....
T Consensus 121 ~~ld~nck~~ii~~GtE~~~s~A~v~lwDvR~~qq~l~~~~eSH~DDVT~lrFHP~~pnlLlSGSvDGLvnlfD~~~d~- 199 (376)
T KOG1188|consen 121 ICLDLNCKKNIIACGTELTRSDASVVLWDVRSEQQLLRQLNESHNDDVTQLRFHPSDPNLLLSGSVDGLVNLFDTKKDN- 199 (376)
T ss_pred eEeeccCcCCeEEeccccccCceEEEEEEeccccchhhhhhhhccCcceeEEecCCCCCeEEeecccceEEeeecCCCc-
Confidence 777777677787775432 99999998766 5444 78999999999999766544445559999999984221
Q ss_pred CccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCcc
Q 036605 191 TVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQD 241 (340)
Q Consensus 191 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~ 241 (340)
....+.-.+.+...+..+ .|.++....+.+-+..+...+|+++.+...
T Consensus 200 -EeDaL~~viN~~sSI~~i--gw~~~~ykrI~clTH~Etf~~~ele~~~~~ 247 (376)
T KOG1188|consen 200 -EEDALLHVINHGSSIHLI--GWLSKKYKRIMCLTHMETFAIYELEDGSEE 247 (376)
T ss_pred -chhhHHHhhcccceeeee--eeecCCcceEEEEEccCceeEEEccCCChh
Confidence 111111112333334434 665666678999999999999999876543
No 143
>KOG0639 consensus Transducin-like enhancer of split protein (contains WD40 repeats) [Chromatin structure and dynamics]
Probab=99.79 E-value=1.9e-18 Score=145.10 Aligned_cols=201 Identities=10% Similarity=0.064 Sum_probs=161.3
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeE--EEecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMK--WKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~--~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
+.-+.++..+|||+ .|++|+.-.++.|||+...... ..+.. ..-..++++.+||.+..++|..||.|.
T Consensus 465 dnyiRSckL~pdgr---------tLivGGeastlsiWDLAapTprikaelts-sapaCyALa~spDakvcFsccsdGnI~ 534 (705)
T KOG0639|consen 465 DNYIRSCKLLPDGR---------TLIVGGEASTLSIWDLAAPTPRIKAELTS-SAPACYALAISPDAKVCFSCCSDGNIA 534 (705)
T ss_pred ccceeeeEecCCCc---------eEEeccccceeeeeeccCCCcchhhhcCC-cchhhhhhhcCCccceeeeeccCCcEE
Confidence 35577888899998 8999999999999999876532 22332 223568899999999999999999999
Q ss_pred EEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcC
Q 036605 99 EMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYG 176 (340)
Q Consensus 99 ~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~ 176 (340)
|||+.+...+..|.+|...+.||.+++||..|-+++-+ |+.||++.++.+.... ..+.|.++.++|.+.+++.+-.
T Consensus 535 vwDLhnq~~VrqfqGhtDGascIdis~dGtklWTGGlDntvRcWDlregrqlqqhd-F~SQIfSLg~cP~~dWlavGMe- 612 (705)
T KOG0639|consen 535 VWDLHNQTLVRQFQGHTDGASCIDISKDGTKLWTGGLDNTVRCWDLREGRQLQQHD-FSSQIFSLGYCPTGDWLAVGME- 612 (705)
T ss_pred EEEcccceeeecccCCCCCceeEEecCCCceeecCCCccceeehhhhhhhhhhhhh-hhhhheecccCCCccceeeecc-
Confidence 99999999999999999999999999999999887655 9999999997765432 2467899999999999999766
Q ss_pred CCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 177 EKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 177 d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
.+.+.|-.. ++.....+. .|...+..+ -| .+-|+++++.+.|+-+..|....+..+.
T Consensus 613 ns~vevlh~---skp~kyqlh---lheScVLSl--KF-a~cGkwfvStGkDnlLnawrtPyGasiF 669 (705)
T KOG0639|consen 613 NSNVEVLHT---SKPEKYQLH---LHESCVLSL--KF-AYCGKWFVSTGKDNLLNAWRTPYGASIF 669 (705)
T ss_pred cCcEEEEec---CCccceeec---ccccEEEEE--Ee-cccCceeeecCchhhhhhccCcccccee
Confidence 888888775 232222223 456666666 55 7789999999999999999887665544
No 144
>KOG1539 consensus WD repeat protein [General function prediction only]
Probab=99.79 E-value=2.7e-17 Score=145.89 Aligned_cols=225 Identities=18% Similarity=0.269 Sum_probs=173.1
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
|+|+..++.+..|+ +..+.|+.++|.-||. .++|+|+..|.+.+||++..+....+...|.+.|....
T Consensus 228 ifNlK~dkil~sFk----~d~g~VtslSFrtDG~--------p~las~~~~G~m~~wDLe~kkl~~v~~nah~~sv~~~~ 295 (910)
T KOG1539|consen 228 IFNLKFDKILMSFK----QDWGRVTSLSFRTDGN--------PLLASGRSNGDMAFWDLEKKKLINVTRNAHYGSVTGAT 295 (910)
T ss_pred EEEcccCcEEEEEE----ccccceeEEEeccCCC--------eeEEeccCCceEEEEEcCCCeeeeeeeccccCCcccce
Confidence 45777788888888 4469999999999995 28999999999999999999988888877999999999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeE-----------------------------------------------------
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEV----------------------------------------------------- 107 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~----------------------------------------------------- 107 (340)
|.|....+++++.|..+++|-..++.-
T Consensus 296 fl~~epVl~ta~~DnSlk~~vfD~~dg~pR~LR~R~GHs~Pp~~irfy~~~g~~ilsa~~Drt~r~fs~~~e~~~~~l~~ 375 (910)
T KOG1539|consen 296 FLPGEPVLVTAGADNSLKVWVFDSGDGVPRLLRSRGGHSAPPSCIRFYGSQGHFILSAKQDRTLRSFSVISESQSQELGQ 375 (910)
T ss_pred ecCCCceEeeccCCCceeEEEeeCCCCcchheeeccCCCCCchheeeeccCcEEEEecccCcchhhhhhhHHHHhHhhcc
Confidence 999888999999998887774321100
Q ss_pred ----------------------E--------------------------EEe-----------------ecCCCCeeEEE
Q 036605 108 ----------------------I--------------------------REF-----------------KASEKPISSSA 122 (340)
Q Consensus 108 ----------------------~--------------------------~~~-----------------~~~~~~i~~l~ 122 (340)
+ .+| +.....+.+++
T Consensus 376 ~~~~~~~kk~~~~~~~~~k~p~i~~fa~~~~RE~~W~Nv~~~h~~~~~~~tW~~~n~~~G~~~L~~~~~~~~~~~~~av~ 455 (910)
T KOG1539|consen 376 LHNKKRAKKVNVFSTEKLKLPPIVEFAFENAREKEWDNVITAHKGKRSAYTWNFRNKTSGRHVLDPKRFKKDDINATAVC 455 (910)
T ss_pred cccccccccccccchhhhcCCcceeeecccchhhhhcceeEEecCcceEEEEeccCcccccEEecCccccccCcceEEEE
Confidence 0 000 00113466777
Q ss_pred EccCCCEEEE--ecCcEEEEECCCCceeEEe---ecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCce
Q 036605 123 FLCEEKIFAL--ASSEVRILSLENGEEVLKF---SDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPA 197 (340)
Q Consensus 123 ~~~~~~~l~~--~~~~i~i~d~~~~~~~~~~---~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~ 197 (340)
.++-|++.+. ..+.|-+|++++|-...+| ..|..+|+.++...-++.+++++. +|.+.+||+. .+.....+.
T Consensus 456 vs~CGNF~~IG~S~G~Id~fNmQSGi~r~sf~~~~ah~~~V~gla~D~~n~~~vsa~~-~Gilkfw~f~--~k~l~~~l~ 532 (910)
T KOG1539|consen 456 VSFCGNFVFIGYSKGTIDRFNMQSGIHRKSFGDSPAHKGEVTGLAVDGTNRLLVSAGA-DGILKFWDFK--KKVLKKSLR 532 (910)
T ss_pred EeccCceEEEeccCCeEEEEEcccCeeecccccCccccCceeEEEecCCCceEEEccC-cceEEEEecC--Ccceeeeec
Confidence 8888887766 4556999999999777777 589999999999999999999888 9999999983 332111000
Q ss_pred ----------------------------e----------eecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCC
Q 036605 198 ----------------------------L----------SMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVS 239 (340)
Q Consensus 198 ----------------------------~----------~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~ 239 (340)
+ -.+|...+.++ .| +|||++|++++.|++|++||+.++.
T Consensus 533 l~~~~~~iv~hr~s~l~a~~~ddf~I~vvD~~t~kvvR~f~gh~nritd~--~F-S~DgrWlisasmD~tIr~wDlpt~~ 609 (910)
T KOG1539|consen 533 LGSSITGIVYHRVSDLLAIALDDFSIRVVDVVTRKVVREFWGHGNRITDM--TF-SPDGRWLISASMDSTIRTWDLPTGT 609 (910)
T ss_pred cCCCcceeeeeehhhhhhhhcCceeEEEEEchhhhhhHHhhccccceeee--Ee-CCCCcEEEEeecCCcEEEEeccCcc
Confidence 0 01355666666 66 9999999999999999999999987
Q ss_pred ccCC
Q 036605 240 QDEK 243 (340)
Q Consensus 240 ~~~~ 243 (340)
.+..
T Consensus 610 lID~ 613 (910)
T KOG1539|consen 610 LIDG 613 (910)
T ss_pred eeee
Confidence 7653
No 145
>KOG0270 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.79 E-value=1.1e-17 Score=138.38 Aligned_cols=210 Identities=11% Similarity=0.067 Sum_probs=150.2
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeE---EEe-----------------cCCCCCCeEEEEE
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMK---WKS-----------------TGRHPGGLAGLAF 81 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~---~~~-----------------~~~h~~~v~~v~~ 81 (340)
..-.|++|...+. +.++...|+|.|+-|..|.|||+.-...+ ..+ ..+|+..|.+++|
T Consensus 174 afPLC~ewld~~~--~~~~~gNyvAiGtmdp~IeIWDLDI~d~v~P~~~LGs~~sk~~~k~~k~~~~~~gHTdavl~Ls~ 251 (463)
T KOG0270|consen 174 AFPLCIEWLDHGS--KSGGAGNYVAIGTMDPEIEIWDLDIVDAVLPCVTLGSKASKKKKKKGKRSNSASGHTDAVLALSW 251 (463)
T ss_pred CcchhhhhhhcCC--CCCCCcceEEEeccCceeEEeccccccccccceeechhhhhhhhhhcccccccccchHHHHHHHh
Confidence 3447888854422 11222349999999999999997532110 000 1138889999999
Q ss_pred ecC-CCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCC-EEEEecC--cEEEEECCCCcee-EEeecCCC
Q 036605 82 AKK-GRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEK-IFALASS--EVRILSLENGEEV-LKFSDDVG 156 (340)
Q Consensus 82 ~~~-~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~-~l~~~~~--~i~i~d~~~~~~~-~~~~~~~~ 156 (340)
+.. .+.|++||.|.+|++||+.+|++...+..|...|.++.|+|... +|++++. ++.++|.+..... ..++ -.+
T Consensus 252 n~~~~nVLaSgsaD~TV~lWD~~~g~p~~s~~~~~k~Vq~l~wh~~~p~~LLsGs~D~~V~l~D~R~~~~s~~~wk-~~g 330 (463)
T KOG0270|consen 252 NRNFRNVLASGSADKTVKLWDVDTGKPKSSITHHGKKVQTLEWHPYEPSVLLSGSYDGTVALKDCRDPSNSGKEWK-FDG 330 (463)
T ss_pred ccccceeEEecCCCceEEEEEcCCCCcceehhhcCCceeEEEecCCCceEEEeccccceEEeeeccCccccCceEE-ecc
Confidence 875 45899999999999999999999999999999999999999754 5566554 4999999853222 2232 246
Q ss_pred CeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECC
Q 036605 157 PLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 157 ~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
.|-.++|.|.....+.++..||+|+-+|+|. .++...... .|...+..+ +++.....++++++.|+.|++|++.
T Consensus 331 ~VEkv~w~~~se~~f~~~tddG~v~~~D~R~-~~~~vwt~~---AHd~~ISgl--~~n~~~p~~l~t~s~d~~Vklw~~~ 404 (463)
T KOG0270|consen 331 EVEKVAWDPHSENSFFVSTDDGTVYYFDIRN-PGKPVWTLK---AHDDEISGL--SVNIQTPGLLSTASTDKVVKLWKFD 404 (463)
T ss_pred ceEEEEecCCCceeEEEecCCceEEeeecCC-CCCceeEEE---eccCCcceE--EecCCCCcceeeccccceEEEEeec
Confidence 7899999998776666676699999999973 333333333 565555444 3334566789999999999999997
Q ss_pred CCCc
Q 036605 237 TVSQ 240 (340)
Q Consensus 237 ~~~~ 240 (340)
....
T Consensus 405 ~~~~ 408 (463)
T KOG0270|consen 405 VDSP 408 (463)
T ss_pred CCCC
Confidence 6443
No 146
>KOG4378 consensus Nuclear protein COP1 [Signal transduction mechanisms]
Probab=99.79 E-value=3.4e-18 Score=143.45 Aligned_cols=184 Identities=13% Similarity=0.210 Sum_probs=148.9
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCC-CCeeEEE
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASE-KPISSSA 122 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~-~~i~~l~ 122 (340)
|+++|+..+.|.|||++...+.+.+.+ |+..|+++.++....+|++++..|.|.+..+.++.....|.... ..+.-+.
T Consensus 93 y~~sgG~~~~Vkiwdl~~kl~hr~lkd-h~stvt~v~YN~~DeyiAsvs~gGdiiih~~~t~~~tt~f~~~sgqsvRll~ 171 (673)
T KOG4378|consen 93 YEISGGQSGCVKIWDLRAKLIHRFLKD-HQSTVTYVDYNNTDEYIASVSDGGDIIIHGTKTKQKTTTFTIDSGQSVRLLR 171 (673)
T ss_pred eeeccCcCceeeehhhHHHHHhhhccC-CcceeEEEEecCCcceeEEeccCCcEEEEecccCccccceecCCCCeEEEee
Confidence 899999999999999996656666676 99999999999999999999999999999999988777787653 3466899
Q ss_pred EccCCCEEEE-ec--CcEEEEECCCCceeEEe-ecCCCCeEEEEECCCCCEE-EEEEcCCCeEEEEEccCCCCCccCCce
Q 036605 123 FLCEEKIFAL-AS--SEVRILSLENGEEVLKF-SDDVGPLQYVSASDGAKII-ITAGYGEKHLQVWRCDISSKTVNKGPA 197 (340)
Q Consensus 123 ~~~~~~~l~~-~~--~~i~i~d~~~~~~~~~~-~~~~~~v~~~~~s~~~~~l-~s~~~~d~~i~iwd~~~~~~~~~~~~~ 197 (340)
++|..+++++ ++ +.|.+||.....++..+ ..|..+...++|+|.+..| ++.|. |..|.+||.+ .+.....+
T Consensus 172 ys~skr~lL~~asd~G~VtlwDv~g~sp~~~~~~~HsAP~~gicfspsne~l~vsVG~-Dkki~~yD~~--s~~s~~~l- 247 (673)
T KOG4378|consen 172 YSPSKRFLLSIASDKGAVTLWDVQGMSPIFHASEAHSAPCRGICFSPSNEALLVSVGY-DKKINIYDIR--SQASTDRL- 247 (673)
T ss_pred cccccceeeEeeccCCeEEEEeccCCCcccchhhhccCCcCcceecCCccceEEEecc-cceEEEeecc--ccccccee-
Confidence 9999888765 33 33999999888777666 7899999999999987654 55566 9999999984 33332222
Q ss_pred eeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 198 LSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 198 ~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
...|+-...++ .++|.+|++|+..|.|+.||++..
T Consensus 248 -~y~~Plstvaf-----~~~G~~L~aG~s~G~~i~YD~R~~ 282 (673)
T KOG4378|consen 248 -TYSHPLSTVAF-----SECGTYLCAGNSKGELIAYDMRST 282 (673)
T ss_pred -eecCCcceeee-----cCCceEEEeecCCceEEEEecccC
Confidence 23455444544 899999999999999999999874
No 147
>KOG2110 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=99.78 E-value=4.5e-16 Score=126.32 Aligned_cols=152 Identities=17% Similarity=0.263 Sum_probs=125.4
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCC--CCCCeEEEEEecCCCEEEEEe--CCCcE
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGR--HPGGLAGLAFAKKGRSLHVVG--TNGMA 97 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~--h~~~v~~v~~~~~~~~l~s~~--~dg~i 97 (340)
.+|.++.+. -+ .|+++-.+. |+|||+.+.++++++... +...+.++++++.+.+|+.-+ ..|.|
T Consensus 88 t~IL~VrmN--r~---------RLvV~Lee~-IyIydI~~MklLhTI~t~~~n~~gl~AlS~n~~n~ylAyp~s~t~GdV 155 (391)
T KOG2110|consen 88 TSILAVRMN--RK---------RLVVCLEES-IYIYDIKDMKLLHTIETTPPNPKGLCALSPNNANCYLAYPGSTTSGDV 155 (391)
T ss_pred CceEEEEEc--cc---------eEEEEEccc-EEEEecccceeehhhhccCCCccceEeeccCCCCceEEecCCCCCceE
Confidence 556666664 22 466665554 999999999999888652 556677777777777887643 34999
Q ss_pred EEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc---EEEEECCCCceeEEeecC--CCCeEEEEECCCCCEEEE
Q 036605 98 SEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE---VRILSLENGEEVLKFSDD--VGPLQYVSASDGAKIIIT 172 (340)
Q Consensus 98 ~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~---i~i~d~~~~~~~~~~~~~--~~~v~~~~~s~~~~~l~s 172 (340)
.+||..+-+.+..+.+|++.+.+++|+++|.+||+++.. |++|.+.+|+.+.+|.-. ...|.+++|+|++++|.+
T Consensus 156 ~l~d~~nl~~v~~I~aH~~~lAalafs~~G~llATASeKGTVIRVf~v~~G~kl~eFRRG~~~~~IySL~Fs~ds~~L~~ 235 (391)
T KOG2110|consen 156 VLFDTINLQPVNTINAHKGPLAALAFSPDGTLLATASEKGTVIRVFSVPEGQKLYEFRRGTYPVSIYSLSFSPDSQFLAA 235 (391)
T ss_pred EEEEcccceeeeEEEecCCceeEEEECCCCCEEEEeccCceEEEEEEcCCccEeeeeeCCceeeEEEEEEECCCCCeEEE
Confidence 999999999999999999999999999999999998766 999999999999998533 356889999999999988
Q ss_pred EEcCCCeEEEEEcc
Q 036605 173 AGYGEKHLQVWRCD 186 (340)
Q Consensus 173 ~~~~d~~i~iwd~~ 186 (340)
++. .++|+||.+.
T Consensus 236 sS~-TeTVHiFKL~ 248 (391)
T KOG2110|consen 236 SSN-TETVHIFKLE 248 (391)
T ss_pred ecC-CCeEEEEEec
Confidence 777 9999999984
No 148
>KOG1063 consensus RNA polymerase II elongator complex, subunit ELP2, WD repeat superfamily [Chromatin structure and dynamics; Transcription]
Probab=99.78 E-value=1.6e-17 Score=144.55 Aligned_cols=206 Identities=11% Similarity=0.098 Sum_probs=161.8
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe----eEEEecCCCCCCeEEEEEecCCCEEEEEeC
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE----MKWKSTGRHPGGLAGLAFAKKGRSLHVVGT 93 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~----~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~ 93 (340)
++|...|+.++|+|.|. +|++.+.|-+-++|-.-..+ .+.+-+- |.-.++|++|-+....+++|..
T Consensus 358 SGH~~~V~dv~W~psGe---------flLsvs~DQTTRlFa~wg~q~~wHEiaRPQi-HGyDl~c~~~vn~~~~FVSgAd 427 (764)
T KOG1063|consen 358 SGHVDGVKDVDWDPSGE---------FLLSVSLDQTTRLFARWGRQQEWHEIARPQI-HGYDLTCLSFVNEDLQFVSGAD 427 (764)
T ss_pred ccccccceeeeecCCCC---------EEEEeccccceeeecccccccceeeeccccc-ccccceeeehccCCceeeeccc
Confidence 59999999999999999 99999999999998654211 1222233 7888999999986667888888
Q ss_pred CCcEEEEeCCC-------------------------------------------Ce------------------------
Q 036605 94 NGMASEMKSEM-------------------------------------------GE------------------------ 106 (340)
Q Consensus 94 dg~i~~wd~~~-------------------------------------------~~------------------------ 106 (340)
...+++|+... |.
T Consensus 428 EKVlRvF~aPk~fv~~l~~i~g~~~~~~~~~p~gA~VpaLGLSnKa~~~~e~~~G~~~~~~~et~~~~~p~~L~ePP~Ed 507 (764)
T KOG1063|consen 428 EKVLRVFEAPKSFVKSLMAICGKCFKGSDELPDGANVPALGLSNKAFFPGETNTGGEAAVCAETPLAAAPCELTEPPTED 507 (764)
T ss_pred ceeeeeecCcHHHHHHHHHHhCccccCchhcccccccccccccCCCCcccccccccccceeeecccccCchhccCCChHH
Confidence 88889997531 00
Q ss_pred ---------EEEEeecCCCCeeEEEEccCCCEEEEecCc-------EEEEECCCCceeEEeecCCCCeEEEEECCCCCEE
Q 036605 107 ---------VIREFKASEKPISSSAFLCEEKIFALASSE-------VRILSLENGEEVLKFSDDVGPLQYVSASDGAKII 170 (340)
Q Consensus 107 ---------~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~-------i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l 170 (340)
.++++.+|...|++++.+|++++++++-.. |++|+..+-.....+.+|.-.|+.++|||||+||
T Consensus 508 qLq~~tLwPEv~KLYGHGyEv~~l~~s~~gnliASaCKS~~~ehAvI~lw~t~~W~~~~~L~~HsLTVT~l~FSpdg~~L 587 (764)
T KOG1063|consen 508 QLQQNTLWPEVHKLYGHGYEVYALAISPTGNLIASACKSSLKEHAVIRLWNTANWLQVQELEGHSLTVTRLAFSPDGRYL 587 (764)
T ss_pred HHHHhccchhhHHhccCceeEEEEEecCCCCEEeehhhhCCccceEEEEEeccchhhhheecccceEEEEEEECCCCcEE
Confidence 012245788899999999999999995443 9999999988888899999999999999999999
Q ss_pred EEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 171 ITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 171 ~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
++.+. |+++.+|... ..-..-..+...-.|...+.++ .| +|++.+++++|.|..|.+|.....
T Consensus 588 LsvsR-DRt~sl~~~~-~~~~~e~~fa~~k~HtRIIWdc--sW-~pde~~FaTaSRDK~VkVW~~~~~ 650 (764)
T KOG1063|consen 588 LSVSR-DRTVSLYEVQ-EDIKDEFRFACLKAHTRIIWDC--SW-SPDEKYFATASRDKKVKVWEEPDL 650 (764)
T ss_pred EEeec-CceEEeeeee-cccchhhhhccccccceEEEEc--cc-CcccceeEEecCCceEEEEeccCc
Confidence 99888 9999999972 1111111122223566666666 88 899999999999999999998876
No 149
>KOG1034 consensus Transcriptional repressor EED/ESC/FIE, required for transcriptional silencing, WD repeat superfamily [Transcription]
Probab=99.78 E-value=5.1e-18 Score=135.48 Aligned_cols=220 Identities=15% Similarity=0.164 Sum_probs=159.1
Q ss_pred ceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCC-C
Q 036605 8 SLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKG-R 86 (340)
Q Consensus 8 ~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~-~ 86 (340)
++++.+..+ .+++...-++|+-+-. .+..+||+|+.-|.|+|.|+.+++....+.+ |...|+.+.|+|+. +
T Consensus 78 r~lq~y~D~--d~~Esfytcsw~yd~~-----~~~p~la~~G~~GvIrVid~~~~~~~~~~~g-hG~sINeik~~p~~~q 149 (385)
T KOG1034|consen 78 RLLQSYADE--DHDESFYTCSWSYDSN-----TGNPFLAAGGYLGVIRVIDVVSGQCSKNYRG-HGGSINEIKFHPDRPQ 149 (385)
T ss_pred eeeeeccCC--CCCcceEEEEEEecCC-----CCCeeEEeecceeEEEEEecchhhhccceec-cCccchhhhcCCCCCc
Confidence 344555544 5777777788976543 1345999999999999999999999989998 99999999999965 6
Q ss_pred EEEEEeCCCcEEEEeCCCCeEEEEe---ecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeE------------
Q 036605 87 SLHVVGTNGMASEMKSEMGEVIREF---KASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVL------------ 149 (340)
Q Consensus 87 ~l~s~~~dg~i~~wd~~~~~~~~~~---~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~------------ 149 (340)
++++++.|..|++|++++...+..| .+|...|.++.|+++|.++++++-+ |++|++...+...
T Consensus 150 lvls~SkD~svRlwnI~~~~Cv~VfGG~egHrdeVLSvD~~~~gd~i~ScGmDhslk~W~l~~~~f~~~lE~s~~~~~~~ 229 (385)
T KOG1034|consen 150 LVLSASKDHSVRLWNIQTDVCVAVFGGVEGHRDEVLSVDFSLDGDRIASCGMDHSLKLWRLNVKEFKNKLELSITYSPNK 229 (385)
T ss_pred EEEEecCCceEEEEeccCCeEEEEecccccccCcEEEEEEcCCCCeeeccCCcceEEEEecChhHHhhhhhhhcccCCCC
Confidence 8999999999999999999988875 5788999999999999999997665 9999997432110
Q ss_pred ----------------EeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCc---c------CCceeeecCCC
Q 036605 150 ----------------KFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTV---N------KGPALSMRHSP 204 (340)
Q Consensus 150 ----------------~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~---~------~~~~~~~~~~~ 204 (340)
+-..|...|.++.|- |.++++-+. ++.|..|.... -++. . ......+..+.
T Consensus 230 t~~pfpt~~~~fp~fst~diHrnyVDCvrw~--gd~ilSksc-enaI~~w~pgk-l~e~~~~vkp~es~~Ti~~~~~~~~ 305 (385)
T KOG1034|consen 230 TTRPFPTPKTHFPDFSTTDIHRNYVDCVRWF--GDFILSKSC-ENAIVCWKPGK-LEESIHNVKPPESATTILGEFDYPM 305 (385)
T ss_pred ccCcCCccccccccccccccccchHHHHHHH--hhheeeccc-CceEEEEecch-hhhhhhccCCCccceeeeeEeccCc
Confidence 012344555555553 568888777 89999998610 0111 0 01111111111
Q ss_pred -eeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCc
Q 036605 205 -VAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQ 240 (340)
Q Consensus 205 -~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~ 240 (340)
.+.-+...+ .+-+..|+.|...|.|++||+.+.+.
T Consensus 306 c~iWfirf~~-d~~~~~la~gnq~g~v~vwdL~~~ep 341 (385)
T KOG1034|consen 306 CDIWFIRFAF-DPWQKMLALGNQSGKVYVWDLDNNEP 341 (385)
T ss_pred cceEEEEEee-cHHHHHHhhccCCCcEEEEECCCCCC
Confidence 111222255 67788899999999999999987544
No 150
>KOG1007 consensus WD repeat protein TSSC1, WD repeat superfamily [Function unknown]
Probab=99.77 E-value=1.7e-17 Score=130.40 Aligned_cols=204 Identities=10% Similarity=0.036 Sum_probs=153.2
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCC-------CcEEEEEccCCe---------eEEEecCCCCCCeEEEEEe
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSN-------GDILAVDVLTGE---------MKWKSTGRHPGGLAGLAFA 82 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~d-------g~i~i~d~~~~~---------~~~~~~~~h~~~v~~v~~~ 82 (340)
||.++|..++-+|-.+ .+|+++..+ -.+-||.+.... .+..+...+-+.|.|+.|.
T Consensus 61 h~agEvw~las~P~d~--------~ilaT~yn~~s~s~vl~~aaiw~ipe~~~~S~~~tlE~v~~Ldteavg~i~cvew~ 132 (370)
T KOG1007|consen 61 HHAGEVWDLASSPFDQ--------RILATVYNDTSDSGVLTGAAIWQIPEPLGQSNSSTLECVASLDTEAVGKINCVEWE 132 (370)
T ss_pred cCCcceehhhcCCCCC--------ceEEEEEeccCCCcceeeEEEEecccccCccccchhhHhhcCCHHHhCceeeEEEc
Confidence 7889999999999873 177777653 246789876432 2334443466799999999
Q ss_pred cCCCEEEEEeCCCcEEEEeCCCCeE-EEEee-----cCCCCeeEEEEcc--CCCEEEE-ecCcEEEEECCCCceeEEe-e
Q 036605 83 KKGRSLHVVGTNGMASEMKSEMGEV-IREFK-----ASEKPISSSAFLC--EEKIFAL-ASSEVRILSLENGEEVLKF-S 152 (340)
Q Consensus 83 ~~~~~l~s~~~dg~i~~wd~~~~~~-~~~~~-----~~~~~i~~l~~~~--~~~~l~~-~~~~i~i~d~~~~~~~~~~-~ 152 (340)
|++..+++.. |..|.+|++..+.. +..+. .+....++-+|+| ++..+++ .++++..||+++......+ .
T Consensus 133 Pns~klasm~-dn~i~l~~l~ess~~vaev~ss~s~e~~~~ftsg~WspHHdgnqv~tt~d~tl~~~D~RT~~~~~sI~d 211 (370)
T KOG1007|consen 133 PNSDKLASMD-DNNIVLWSLDESSKIVAEVLSSESAEMRHSFTSGAWSPHHDGNQVATTSDSTLQFWDLRTMKKNNSIED 211 (370)
T ss_pred CCCCeeEEec-cCceEEEEcccCcchheeecccccccccceecccccCCCCccceEEEeCCCcEEEEEccchhhhcchhh
Confidence 9999998866 78999999988765 33332 2344567778888 6777766 5666999999998777666 6
Q ss_pred cCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEE
Q 036605 153 DDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYS 232 (340)
Q Consensus 153 ~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~v 232 (340)
.|...|..+.|+|+-+++++++..||.|+|||.| ..+.....+. +|..++..+ -|...-..++++|+.|..|.+
T Consensus 212 AHgq~vrdlDfNpnkq~~lvt~gDdgyvriWD~R-~tk~pv~el~---~HsHWvW~V--Rfn~~hdqLiLs~~SDs~V~L 285 (370)
T KOG1007|consen 212 AHGQRVRDLDFNPNKQHILVTCGDDGYVRIWDTR-KTKFPVQELP---GHSHWVWAV--RFNPEHDQLILSGGSDSAVNL 285 (370)
T ss_pred hhcceeeeccCCCCceEEEEEcCCCccEEEEecc-CCCccccccC---CCceEEEEE--EecCccceEEEecCCCceeEE
Confidence 7888999999999987766555559999999997 3444445555 788899888 443455678999999999999
Q ss_pred EECCC
Q 036605 233 WDLKT 237 (340)
Q Consensus 233 wd~~~ 237 (340)
|....
T Consensus 286 sca~s 290 (370)
T KOG1007|consen 286 SCASS 290 (370)
T ss_pred Eeccc
Confidence 97665
No 151
>KOG4283 consensus Transcription-coupled repair protein CSA, contains WD40 domain [Transcription; Replication, recombination and repair]
Probab=99.77 E-value=7.8e-17 Score=127.08 Aligned_cols=157 Identities=8% Similarity=0.058 Sum_probs=132.8
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecC---CCEEEEEeCC
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKK---GRSLHVVGTN 94 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~---~~~l~s~~~d 94 (340)
.+|...|+.+.|-|-.. .++.+++-|.++++||+.+-+....|. .++.|+.-+|+|- ..++++|..|
T Consensus 98 ~~Hky~iss~~WyP~Dt--------GmFtssSFDhtlKVWDtnTlQ~a~~F~--me~~VYshamSp~a~sHcLiA~gtr~ 167 (397)
T KOG4283|consen 98 NGHKYAISSAIWYPIDT--------GMFTSSSFDHTLKVWDTNTLQEAVDFK--MEGKVYSHAMSPMAMSHCLIAAGTRD 167 (397)
T ss_pred ccceeeeeeeEEeeecC--------ceeecccccceEEEeecccceeeEEee--cCceeehhhcChhhhcceEEEEecCC
Confidence 47889999999999874 179999999999999999988777776 6778999999883 3467778888
Q ss_pred CcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE---ecCcEEEEECCCC-ceeEE--------------eecCCC
Q 036605 95 GMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL---ASSEVRILSLENG-EEVLK--------------FSDDVG 156 (340)
Q Consensus 95 g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~---~~~~i~i~d~~~~-~~~~~--------------~~~~~~ 156 (340)
-.|++.|+.+|..-+.+.+|...|.++.|+|...+++. +++.|++||++.. ..+.. -..|.+
T Consensus 168 ~~VrLCDi~SGs~sH~LsGHr~~vlaV~Wsp~~e~vLatgsaDg~irlWDiRrasgcf~~lD~hn~k~~p~~~~n~ah~g 247 (397)
T KOG4283|consen 168 VQVRLCDIASGSFSHTLSGHRDGVLAVEWSPSSEWVLATGSADGAIRLWDIRRASGCFRVLDQHNTKRPPILKTNTAHYG 247 (397)
T ss_pred CcEEEEeccCCcceeeeccccCceEEEEeccCceeEEEecCCCceEEEEEeecccceeEEeecccCccCccccccccccc
Confidence 99999999999999999999999999999999888744 5556999999753 12222 245778
Q ss_pred CeEEEEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 157 PLQYVSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 157 ~v~~~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
.+..++|+.++.++++++. |..+++|+.
T Consensus 248 kvngla~tSd~~~l~~~gt-d~r~r~wn~ 275 (397)
T KOG4283|consen 248 KVNGLAWTSDARYLASCGT-DDRIRVWNM 275 (397)
T ss_pred eeeeeeecccchhhhhccC-ccceEEeec
Confidence 8999999999999999999 999999998
No 152
>KOG1034 consensus Transcriptional repressor EED/ESC/FIE, required for transcriptional silencing, WD repeat superfamily [Transcription]
Probab=99.76 E-value=5.8e-18 Score=135.18 Aligned_cols=214 Identities=12% Similarity=0.153 Sum_probs=151.6
Q ss_pred ccCCCCceeeeeeCCCCCCCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCeeEEEecC--CCCCCeEE
Q 036605 2 WSTNDGSLLAEWKQPDGEPVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTG--RHPGGLAG 78 (340)
Q Consensus 2 wd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~--~h~~~v~~ 78 (340)
.|+.++++...+. +|...|+.+.|+|+. + ++++++.|.+|++||+++..++..+-+ +|.+.|.+
T Consensus 120 id~~~~~~~~~~~----ghG~sINeik~~p~~~q---------lvls~SkD~svRlwnI~~~~Cv~VfGG~egHrdeVLS 186 (385)
T KOG1034|consen 120 IDVVSGQCSKNYR----GHGGSINEIKFHPDRPQ---------LVLSASKDHSVRLWNIQTDVCVAVFGGVEGHRDEVLS 186 (385)
T ss_pred Eecchhhhcccee----ccCccchhhhcCCCCCc---------EEEEecCCceEEEEeccCCeEEEEecccccccCcEEE
Confidence 4666777777777 899999999999998 6 999999999999999999998888765 69999999
Q ss_pred EEEecCCCEEEEEeCCCcEEEEeCCCCeEEEE----------------------------eecCCCCeeEEEEccCCCEE
Q 036605 79 LAFAKKGRSLHVVGTNGMASEMKSEMGEVIRE----------------------------FKASEKPISSSAFLCEEKIF 130 (340)
Q Consensus 79 v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~----------------------------~~~~~~~i~~l~~~~~~~~l 130 (340)
+.|+++|.++++|+.|..+++|++...+.... -.-|...|.|+.|- |.++
T Consensus 187 vD~~~~gd~i~ScGmDhslk~W~l~~~~f~~~lE~s~~~~~~~t~~pfpt~~~~fp~fst~diHrnyVDCvrw~--gd~i 264 (385)
T KOG1034|consen 187 VDFSLDGDRIASCGMDHSLKLWRLNVKEFKNKLELSITYSPNKTTRPFPTPKTHFPDFSTTDIHRNYVDCVRWF--GDFI 264 (385)
T ss_pred EEEcCCCCeeeccCCcceEEEEecChhHHhhhhhhhcccCCCCccCcCCccccccccccccccccchHHHHHHH--hhhe
Confidence 99999999999999999999999874321111 11234445555554 3566
Q ss_pred EE--ecCcEEEEECC-CCc-------------eeEEeecCCCCeEEEEE--CCCCCEEEEEEcCCCeEEEEEccCCCCCc
Q 036605 131 AL--ASSEVRILSLE-NGE-------------EVLKFSDDVGPLQYVSA--SDGAKIIITAGYGEKHLQVWRCDISSKTV 192 (340)
Q Consensus 131 ~~--~~~~i~i~d~~-~~~-------------~~~~~~~~~~~v~~~~~--s~~~~~l~s~~~~d~~i~iwd~~~~~~~~ 192 (340)
++ +++.|..|... -++ .+.++.-....++-+.| .|-++.|+.+.. .|.|.+||++... .
T Consensus 265 lSkscenaI~~w~pgkl~e~~~~vkp~es~~Ti~~~~~~~~c~iWfirf~~d~~~~~la~gnq-~g~v~vwdL~~~e--p 341 (385)
T KOG1034|consen 265 LSKSCENAIVCWKPGKLEESIHNVKPPESATTILGEFDYPMCDIWFIRFAFDPWQKMLALGNQ-SGKVYVWDLDNNE--P 341 (385)
T ss_pred eecccCceEEEEecchhhhhhhccCCCccceeeeeEeccCccceEEEEEeecHHHHHHhhccC-CCcEEEEECCCCC--C
Confidence 65 55569999762 111 12334334455666655 666888888776 9999999995322 2
Q ss_pred cCCceeeecC-CCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECC
Q 036605 193 NKGPALSMRH-SPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 193 ~~~~~~~~~~-~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
.....+.... ...+... ++ +.|+..|+..+.|+.|.-||..
T Consensus 342 ~~~ttl~~s~~~~tVRQ~--sf-S~dgs~lv~vcdd~~Vwrwdrv 383 (385)
T KOG1034|consen 342 PKCTTLTHSKSGSTVRQT--SF-SRDGSILVLVCDDGTVWRWDRV 383 (385)
T ss_pred ccCceEEeccccceeeee--ee-cccCcEEEEEeCCCcEEEEEee
Confidence 2222211111 1122222 45 8999999999999999999853
No 153
>KOG0268 consensus Sof1-like rRNA processing protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.76 E-value=3e-18 Score=138.46 Aligned_cols=170 Identities=14% Similarity=0.156 Sum_probs=138.7
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
|||...-..+..+. -....+.|+.|+|... .+|++|..|+.|.+||+.++..++.+. -...-+.|+
T Consensus 171 IWD~~R~~Pv~sms----wG~Dti~svkfNpvET--------sILas~~sDrsIvLyD~R~~~Pl~KVi--~~mRTN~Is 236 (433)
T KOG0268|consen 171 IWDEQRDNPVSSMS----WGADSISSVKFNPVET--------SILASCASDRSIVLYDLRQASPLKKVI--LTMRTNTIC 236 (433)
T ss_pred ecccccCCccceee----cCCCceeEEecCCCcc--------hheeeeccCCceEEEecccCCccceee--eecccccee
Confidence 57776666666665 4457889999999884 288889899999999999999887776 455778999
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCe-EEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEe-ecCCC
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGE-VIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKF-SDDVG 156 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~-~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~-~~~~~ 156 (340)
|+|.+-.+.+++.|..++.+|++.-. ++....+|.+.|.+++|+|.|+.+++++.+ |+||....+..--.+ ...-.
T Consensus 237 wnPeafnF~~a~ED~nlY~~DmR~l~~p~~v~~dhvsAV~dVdfsptG~EfvsgsyDksIRIf~~~~~~SRdiYhtkRMq 316 (433)
T KOG0268|consen 237 WNPEAFNFVAANEDHNLYTYDMRNLSRPLNVHKDHVSAVMDVDFSPTGQEFVSGSYDKSIRIFPVNHGHSRDIYHTKRMQ 316 (433)
T ss_pred cCccccceeeccccccceehhhhhhcccchhhcccceeEEEeccCCCcchhccccccceEEEeecCCCcchhhhhHhhhh
Confidence 99977788889999999999988654 455677899999999999999999998776 999998876433222 12236
Q ss_pred CeEEEEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 157 PLQYVSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 157 ~v~~~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
.|.++.|+-|.+|+++|+. |+.|++|..
T Consensus 317 ~V~~Vk~S~Dskyi~SGSd-d~nvRlWka 344 (433)
T KOG0268|consen 317 HVFCVKYSMDSKYIISGSD-DGNVRLWKA 344 (433)
T ss_pred eeeEEEEeccccEEEecCC-Ccceeeeec
Confidence 7899999999999999777 999999997
No 154
>KOG0307 consensus Vesicle coat complex COPII, subunit SEC31 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.76 E-value=3.4e-18 Score=156.52 Aligned_cols=210 Identities=19% Similarity=0.175 Sum_probs=157.1
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC---Ce---eEEEecCCCCCCeEEEEEecCCC-EEEEEeC
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT---GE---MKWKSTGRHPGGLAGLAFAKKGR-SLHVVGT 93 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~---~~---~~~~~~~~h~~~v~~v~~~~~~~-~l~s~~~ 93 (340)
......|+|++.+.+- ..+||.|..||.|.+||... +. .+.++.. |.+.|..+.|++... +|++|+.
T Consensus 64 ~~rF~kL~W~~~g~~~-----~GlIaGG~edG~I~ly~p~~~~~~~~~~~la~~~~-h~G~V~gLDfN~~q~nlLASGa~ 137 (1049)
T KOG0307|consen 64 SNRFNKLAWGSYGSHS-----HGLIAGGLEDGNIVLYDPASIIANASEEVLATKSK-HTGPVLGLDFNPFQGNLLASGAD 137 (1049)
T ss_pred cccceeeeecccCCCc-----cceeeccccCCceEEecchhhccCcchHHHhhhcc-cCCceeeeeccccCCceeeccCC
Confidence 4678899999887510 12699999999999999765 21 3445555 999999999999655 9999999
Q ss_pred CCcEEEEeCCCCeEEEEee--cCCCCeeEEEEccCCCEE-EEecC--cEEEEECCCCceeEEeecCCC--CeEEEEECCC
Q 036605 94 NGMASEMKSEMGEVIREFK--ASEKPISSSAFLCEEKIF-ALASS--EVRILSLENGEEVLKFSDDVG--PLQYVSASDG 166 (340)
Q Consensus 94 dg~i~~wd~~~~~~~~~~~--~~~~~i~~l~~~~~~~~l-~~~~~--~i~i~d~~~~~~~~~~~~~~~--~v~~~~~s~~ 166 (340)
||.|.+||+..-+.-.... .....|.+++|+..-.++ ++++. .+.|||++..+.+..+..+.. .+..++|+|+
T Consensus 138 ~geI~iWDlnn~~tP~~~~~~~~~~eI~~lsWNrkvqhILAS~s~sg~~~iWDlr~~~pii~ls~~~~~~~~S~l~WhP~ 217 (1049)
T KOG0307|consen 138 DGEILIWDLNKPETPFTPGSQAPPSEIKCLSWNRKVSHILASGSPSGRAVIWDLRKKKPIIKLSDTPGRMHCSVLAWHPD 217 (1049)
T ss_pred CCcEEEeccCCcCCCCCCCCCCCcccceEeccchhhhHHhhccCCCCCceeccccCCCcccccccCCCccceeeeeeCCC
Confidence 9999999998644332221 134679999999865544 55443 499999999988888765554 5778999998
Q ss_pred CC-EEEEEEcCC--CeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 167 AK-IIITAGYGE--KHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 167 ~~-~l~s~~~~d--~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
+. .+++++..| -.|.+||+|..+ .....+. .|...++.+ .|...|..+|++++.|++|.+|+.++++.+.
T Consensus 218 ~aTql~~As~dd~~PviqlWDlR~as-sP~k~~~---~H~~Gilsl--sWc~~D~~lllSsgkD~~ii~wN~~tgEvl~ 290 (1049)
T KOG0307|consen 218 HATQLLVASGDDSAPVIQLWDLRFAS-SPLKILE---GHQRGILSL--SWCPQDPRLLLSSGKDNRIICWNPNTGEVLG 290 (1049)
T ss_pred CceeeeeecCCCCCceeEeecccccC-Cchhhhc---ccccceeee--ccCCCCchhhhcccCCCCeeEecCCCceEee
Confidence 64 344444433 469999997332 2333444 788888888 8866777999999999999999999977766
No 155
>KOG1587 consensus Cytoplasmic dynein intermediate chain [Cytoskeleton]
Probab=99.76 E-value=7.7e-17 Score=143.18 Aligned_cols=217 Identities=16% Similarity=0.176 Sum_probs=156.9
Q ss_pred CccCCCC-ceeeeeeCCCCCCCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCee-----EEEecCCCC
Q 036605 1 IWSTNDG-SLLAEWKQPDGEPVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGEM-----KWKSTGRHP 73 (340)
Q Consensus 1 vwd~~~g-~~~~~~~~~~~~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~-----~~~~~~~h~ 73 (340)
|||..+. .....+. -...|+|+.|+|.. . ++|.|+.+|.|.+||+..+.. +......|.
T Consensus 226 vW~~~~p~~Pe~~~~-----~~s~v~~~~f~p~~p~---------ll~gG~y~GqV~lWD~~~~~~~~~s~ls~~~~sh~ 291 (555)
T KOG1587|consen 226 VWSLKNPNTPELVLE-----SPSEVTCLKFCPFDPN---------LLAGGCYNGQVVLWDLRKGSDTPPSGLSALEVSHS 291 (555)
T ss_pred EEecCCCCCceEEEe-----cCCceeEEEeccCCcc---------eEEeeccCceEEEEEccCCCCCCCcccccccccCC
Confidence 5776554 2333333 45899999999987 5 899999999999999987764 223334699
Q ss_pred CCeEEEEEecCCC--EEEEEeCCCcEEEEeCCCC---------------------------------------------e
Q 036605 74 GGLAGLAFAKKGR--SLHVVGTNGMASEMKSEMG---------------------------------------------E 106 (340)
Q Consensus 74 ~~v~~v~~~~~~~--~l~s~~~dg~i~~wd~~~~---------------------------------------------~ 106 (340)
.+++.+.|..+.. -+++++.||.|..|+++.- .
T Consensus 292 ~~v~~vvW~~~~~~~~f~s~ssDG~i~~W~~~~l~~P~e~~~~~~~~~~~~~~~~~~~~t~~~F~~~~p~~FiVGTe~G~ 371 (555)
T KOG1587|consen 292 EPVTAVVWLQNEHNTEFFSLSSDGSICSWDTDMLSLPVEGLLLESKKHKGQQSSKAVGATSLKFEPTDPNHFIVGTEEGK 371 (555)
T ss_pred cCeEEEEEeccCCCCceEEEecCCcEeeeeccccccchhhcccccccccccccccccceeeEeeccCCCceEEEEcCCcE
Confidence 9999999976544 4999999999999986521 0
Q ss_pred EE------------------EEeecCCCCeeEEEEccCCCEEEE--ecCcEEEEECC-CCceeEEeecCCCCeEEEEECC
Q 036605 107 VI------------------REFKASEKPISSSAFLCEEKIFAL--ASSEVRILSLE-NGEEVLKFSDDVGPLQYVSASD 165 (340)
Q Consensus 107 ~~------------------~~~~~~~~~i~~l~~~~~~~~l~~--~~~~i~i~d~~-~~~~~~~~~~~~~~v~~~~~s~ 165 (340)
.. ..+..|.++|+++.++|-+..++. +|..++||... ...++..+..+...+++++|||
T Consensus 372 v~~~~r~g~~~~~~~~~~~~~~~~~h~g~v~~v~~nPF~~k~fls~gDW~vriWs~~~~~~Pl~~~~~~~~~v~~vaWSp 451 (555)
T KOG1587|consen 372 VYKGCRKGYTPAPEVSYKGHSTFITHIGPVYAVSRNPFYPKNFLSVGDWTVRIWSEDVIASPLLSLDSSPDYVTDVAWSP 451 (555)
T ss_pred EEEEeccCCcccccccccccccccccCcceEeeecCCCccceeeeeccceeEeccccCCCCcchhhhhccceeeeeEEcC
Confidence 00 112235677888999997765543 55559999988 6677777877888899999999
Q ss_pred CCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 166 GAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 166 ~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
....++.+...||.+.+||+............ +. .+....+ .| ++.|..|++|...|.+++|++..
T Consensus 452 trpavF~~~d~~G~l~iWDLl~~~~~Pv~s~~--~~-~~~l~~~--~~-s~~g~~lavGd~~G~~~~~~l~~ 517 (555)
T KOG1587|consen 452 TRPAVFATVDGDGNLDIWDLLQDDEEPVLSQK--VC-SPALTRV--RW-SPNGKLLAVGDANGTTHILKLSE 517 (555)
T ss_pred cCceEEEEEcCCCceehhhhhccccCCccccc--cc-cccccee--ec-CCCCcEEEEecCCCcEEEEEcCc
Confidence 98888887888999999999543333222222 12 1111112 33 78899999999999999999854
No 156
>KOG2919 consensus Guanine nucleotide-binding protein [General function prediction only]
Probab=99.76 E-value=2.8e-17 Score=131.10 Aligned_cols=173 Identities=14% Similarity=0.167 Sum_probs=134.7
Q ss_pred CccCCCCceeeeeeCCCCCCCC---CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEc-cCCee--E-EEec---C
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVV---SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDV-LTGEM--K-WKST---G 70 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~---~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~-~~~~~--~-~~~~---~ 70 (340)
|||..+|++...|..- .|-. ...||+|+|||. .|++| ....|++||+ +.|+. + .++. .
T Consensus 137 ~wdaftG~lraSy~~y--dh~de~taAhsL~Fs~DGe---------qlfaG-ykrcirvFdt~RpGr~c~vy~t~~~~k~ 204 (406)
T KOG2919|consen 137 LWDAFTGKLRASYRAY--DHQDEYTAAHSLQFSPDGE---------QLFAG-YKRCIRVFDTSRPGRDCPVYTTVTKGKF 204 (406)
T ss_pred eeeccccccccchhhh--hhHHhhhhheeEEecCCCC---------eEeec-ccceEEEeeccCCCCCCcchhhhhcccc
Confidence 6999999999888754 3443 456899999998 67776 4668999998 44431 1 1111 1
Q ss_pred CCCCCeEEEEEecCCC-EEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc---EEEEECCCC-
Q 036605 71 RHPGGLAGLAFAKKGR-SLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE---VRILSLENG- 145 (340)
Q Consensus 71 ~h~~~v~~v~~~~~~~-~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~---i~i~d~~~~- 145 (340)
+..+.|.+++|+|... .++.++....+-++.-..+.++..+.+|.+.|+.+.|.++|+.|+++.+. |..||++..
T Consensus 205 gq~giisc~a~sP~~~~~~a~gsY~q~~giy~~~~~~pl~llggh~gGvThL~~~edGn~lfsGaRk~dkIl~WDiR~~~ 284 (406)
T KOG2919|consen 205 GQKGIISCFAFSPMDSKTLAVGSYGQRVGIYNDDGRRPLQLLGGHGGGVTHLQWCEDGNKLFSGARKDDKILCWDIRYSR 284 (406)
T ss_pred cccceeeeeeccCCCCcceeeecccceeeeEecCCCCceeeecccCCCeeeEEeccCcCeecccccCCCeEEEEeehhcc
Confidence 2467899999999655 78888888888888888889999999999999999999999999997765 999999864
Q ss_pred ceeEEeecCCC-CeEEEEE--CCCCCEEEEEEcCCCeEEEEEcc
Q 036605 146 EEVLKFSDDVG-PLQYVSA--SDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 146 ~~~~~~~~~~~-~v~~~~~--s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
.++..+..|.. .-..|.| .|++++|++++. ||.|++||+.
T Consensus 285 ~pv~~L~rhv~~TNQRI~FDld~~~~~LasG~t-dG~V~vwdlk 327 (406)
T KOG2919|consen 285 DPVYALERHVGDTNQRILFDLDPKGEILASGDT-DGSVRVWDLK 327 (406)
T ss_pred chhhhhhhhccCccceEEEecCCCCceeeccCC-CccEEEEecC
Confidence 45566666665 3334555 788999999777 9999999984
No 157
>KOG2445 consensus Nuclear pore complex component (sc Seh1) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=99.76 E-value=4.5e-16 Score=123.42 Aligned_cols=206 Identities=14% Similarity=0.132 Sum_probs=148.4
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe----eEEEecCCCCCCeEEEEEec--CCCEEEEE
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE----MKWKSTGRHPGGLAGLAFAK--KGRSLHVV 91 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~----~~~~~~~~h~~~v~~v~~~~--~~~~l~s~ 91 (340)
.+|..-|+|+.|.+-|+ .+|+|+.|++|.|||..... +...... |.+.|..+.|.+ -|+.+++|
T Consensus 10 s~h~DlihdVs~D~~GR---------RmAtCSsDq~vkI~d~~~~s~~W~~Ts~Wra-h~~Si~rV~WAhPEfGqvvA~c 79 (361)
T KOG2445|consen 10 SGHKDLIHDVSFDFYGR---------RMATCSSDQTVKIWDSTSDSGTWSCTSSWRA-HDGSIWRVVWAHPEFGQVVATC 79 (361)
T ss_pred cCCcceeeeeeecccCc---------eeeeccCCCcEEEEeccCCCCceEEeeeEEe-cCCcEEEEEecCccccceEEEE
Confidence 57889999999999998 89999999999999975543 3334455 999999999976 48899999
Q ss_pred eCCCcEEEEeCCC---------CeEEEEeecCCCCeeEEEEccC--CCEEEE--ecCcEEEEECCCCcee------EEee
Q 036605 92 GTNGMASEMKSEM---------GEVIREFKASEKPISSSAFLCE--EKIFAL--ASSEVRILSLENGEEV------LKFS 152 (340)
Q Consensus 92 ~~dg~i~~wd~~~---------~~~~~~~~~~~~~i~~l~~~~~--~~~l~~--~~~~i~i~d~~~~~~~------~~~~ 152 (340)
+.|+++.+|.-.. .....++......|+.+.|.|. |..+++ +++.++||+.-..-.+ ..+.
T Consensus 80 S~Drtv~iWEE~~~~~~~~~~~Wv~~ttl~DsrssV~DV~FaP~hlGLklA~~~aDG~lRIYEA~dp~nLs~W~Lq~Ei~ 159 (361)
T KOG2445|consen 80 SYDRTVSIWEEQEKSEEAHGRRWVRRTTLVDSRSSVTDVKFAPKHLGLKLAAASADGILRIYEAPDPMNLSQWTLQHEIQ 159 (361)
T ss_pred ecCCceeeeeecccccccccceeEEEEEeecCCcceeEEEecchhcceEEEEeccCcEEEEEecCCccccccchhhhhhh
Confidence 9999999997521 1233446667788999999996 455666 5556999987543222 2222
Q ss_pred -------cCCCCeEEEEECCC---CCEEEEEEcC----CCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCC---C
Q 036605 153 -------DDVGPLQYVSASDG---AKIIITAGYG----EKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPN---G 215 (340)
Q Consensus 153 -------~~~~~v~~~~~s~~---~~~l~s~~~~----d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~---~ 215 (340)
.+..+..++.|+|. ..+|+.++.. -+.+.||..+....+......+. ++...+.++ +|. .
T Consensus 160 ~~~~pp~~~~~~~~CvsWn~sr~~~p~iAvgs~e~a~~~~~~~Iye~~e~~rKw~kva~L~-d~~dpI~di--~wAPn~G 236 (361)
T KOG2445|consen 160 NVIDPPGKNKQPCFCVSWNPSRMHEPLIAVGSDEDAPHLNKVKIYEYNENGRKWLKVAELP-DHTDPIRDI--SWAPNIG 236 (361)
T ss_pred hccCCcccccCcceEEeeccccccCceEEEEcccCCccccceEEEEecCCcceeeeehhcC-CCCCcceee--eeccccC
Confidence 35577889999875 4567775542 14899998853333333333332 777778777 552 2
Q ss_pred CCCCEEEEEeCCCcEEEEECCC
Q 036605 216 EDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 216 ~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
.....|++++.|| |+||.+..
T Consensus 237 r~y~~lAvA~kDg-v~I~~v~~ 257 (361)
T KOG2445|consen 237 RSYHLLAVATKDG-VRIFKVKV 257 (361)
T ss_pred CceeeEEEeecCc-EEEEEEee
Confidence 2345789999999 99999985
No 158
>KOG4378 consensus Nuclear protein COP1 [Signal transduction mechanisms]
Probab=99.75 E-value=4.5e-17 Score=136.83 Aligned_cols=190 Identities=14% Similarity=0.138 Sum_probs=148.9
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
|||+....+.+.++ +|...|+|+.+.-... |||+++..|.|.|..+.++.....|.......|.-+.
T Consensus 105 iwdl~~kl~hr~lk----dh~stvt~v~YN~~De---------yiAsvs~gGdiiih~~~t~~~tt~f~~~sgqsvRll~ 171 (673)
T KOG4378|consen 105 IWDLRAKLIHRFLK----DHQSTVTYVDYNNTDE---------YIASVSDGGDIIIHGTKTKQKTTTFTIDSGQSVRLLR 171 (673)
T ss_pred ehhhHHHHHhhhcc----CCcceeEEEEecCCcc---------eeEEeccCCcEEEEecccCccccceecCCCCeEEEee
Confidence 68988666666666 8999999999998888 9999999999999999998877677642344567999
Q ss_pred EecCCC-EEEEEeCCCcEEEEeCCCCeEEEEe-ecCCCCeeEEEEccCCCEE-EEecCc--EEEEECCCCceeEEeecCC
Q 036605 81 FAKKGR-SLHVVGTNGMASEMKSEMGEVIREF-KASEKPISSSAFLCEEKIF-ALASSE--VRILSLENGEEVLKFSDDV 155 (340)
Q Consensus 81 ~~~~~~-~l~s~~~dg~i~~wd~~~~~~~~~~-~~~~~~i~~l~~~~~~~~l-~~~~~~--i~i~d~~~~~~~~~~~~~~ 155 (340)
|+|..+ +|.+++.+|.|.+||+....++..+ +.|..+...|+|+|....| ++.+.+ |.+||.+..+....+. ..
T Consensus 172 ys~skr~lL~~asd~G~VtlwDv~g~sp~~~~~~~HsAP~~gicfspsne~l~vsVG~Dkki~~yD~~s~~s~~~l~-y~ 250 (673)
T KOG4378|consen 172 YSPSKRFLLSIASDKGAVTLWDVQGMSPIFHASEAHSAPCRGICFSPSNEALLVSVGYDKKINIYDIRSQASTDRLT-YS 250 (673)
T ss_pred cccccceeeEeeccCCeEEEEeccCCCcccchhhhccCCcCcceecCCccceEEEecccceEEEeecccccccceee-ec
Confidence 999776 4667888999999999887777664 5788999999999987655 554444 9999999876665554 35
Q ss_pred CCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeee
Q 036605 156 GPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDC 209 (340)
Q Consensus 156 ~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~ 209 (340)
.+...++|+++|.+|+++.. .|.|..||+| ..+....... .|...+..+
T Consensus 251 ~Plstvaf~~~G~~L~aG~s-~G~~i~YD~R-~~k~Pv~v~s---ah~~sVt~v 299 (673)
T KOG4378|consen 251 HPLSTVAFSECGTYLCAGNS-KGELIAYDMR-STKAPVAVRS---AHDASVTRV 299 (673)
T ss_pred CCcceeeecCCceEEEeecC-CceEEEEecc-cCCCCceEee---ecccceeEE
Confidence 68899999999999988777 9999999997 3444444444 555555544
No 159
>KOG2096 consensus WD40 repeat protein [General function prediction only]
Probab=99.74 E-value=5.5e-17 Score=129.20 Aligned_cols=167 Identities=17% Similarity=0.279 Sum_probs=131.5
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC---Ce-----eEEEecCCC
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT---GE-----MKWKSTGRH 72 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~---~~-----~~~~~~~~h 72 (340)
||++. |+++..+. .....-+..+.||+|+ ++|+++-.-.|.+|.+-- |. .+..+.+ |
T Consensus 213 lw~lk-Gq~L~~id----tnq~~n~~aavSP~GR---------Fia~~gFTpDVkVwE~~f~kdG~fqev~rvf~LkG-H 277 (420)
T KOG2096|consen 213 LWDLK-GQLLQSID----TNQSSNYDAAVSPDGR---------FIAVSGFTPDVKVWEPIFTKDGTFQEVKRVFSLKG-H 277 (420)
T ss_pred EEecC-Cceeeeec----cccccccceeeCCCCc---------EEEEecCCCCceEEEEEeccCcchhhhhhhheecc-c
Confidence 58887 88887766 3344556678999999 999999999999998642 22 3445677 9
Q ss_pred CCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCC-------eEEEE----eecCCCCeeEEEEccCCCEEEEecCc-EEEE
Q 036605 73 PGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMG-------EVIRE----FKASEKPISSSAFLCEEKIFALASSE-VRIL 140 (340)
Q Consensus 73 ~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~-------~~~~~----~~~~~~~i~~l~~~~~~~~l~~~~~~-i~i~ 140 (340)
+..|..++|+++...+++.+.||.+++||..-. +.+.. +....+....++++|+|..|+.+.+. +++|
T Consensus 278 ~saV~~~aFsn~S~r~vtvSkDG~wriwdtdVrY~~~qDpk~Lk~g~~pl~aag~~p~RL~lsP~g~~lA~s~gs~l~~~ 357 (420)
T KOG2096|consen 278 QSAVLAAAFSNSSTRAVTVSKDGKWRIWDTDVRYEAGQDPKILKEGSAPLHAAGSEPVRLELSPSGDSLAVSFGSDLKVF 357 (420)
T ss_pred hhheeeeeeCCCcceeEEEecCCcEEEeeccceEecCCCchHhhcCCcchhhcCCCceEEEeCCCCcEEEeecCCceEEE
Confidence 999999999999999999999999999997521 11111 11223334589999999999886555 9999
Q ss_pred ECCCCceeEEe-ecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEE
Q 036605 141 SLENGEEVLKF-SDDVGPLQYVSASDGAKIIITAGYGEKHLQVWR 184 (340)
Q Consensus 141 d~~~~~~~~~~-~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd 184 (340)
..++++....+ ..|...|.+++|+++|++++++| |+.++++.
T Consensus 358 ~se~g~~~~~~e~~h~~~Is~is~~~~g~~~atcG--dr~vrv~~ 400 (420)
T KOG2096|consen 358 ASEDGKDYPELEDIHSTTISSISYSSDGKYIATCG--DRYVRVIR 400 (420)
T ss_pred EcccCccchhHHHhhcCceeeEEecCCCcEEeeec--ceeeeeec
Confidence 99999877666 67899999999999999999965 68888876
No 160
>KOG1523 consensus Actin-related protein Arp2/3 complex, subunit ARPC1/p41-ARC [Cytoskeleton]
Probab=99.74 E-value=4.4e-16 Score=124.15 Aligned_cols=206 Identities=12% Similarity=0.085 Sum_probs=155.3
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe---eEEEecCCCCCCeEEEEEecCCCEEEEEeCCCc
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE---MKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGM 96 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~---~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~ 96 (340)
...+|+|.+|++|.. .+|++.++..|.||...... ..+++.. |...|++|+|+|..+.|++|+.|..
T Consensus 9 ~~~pitchAwn~drt---------~iAv~~~~~evhiy~~~~~~~w~~~htls~-Hd~~vtgvdWap~snrIvtcs~drn 78 (361)
T KOG1523|consen 9 LLEPITCHAWNSDRT---------QIAVSPNNHEVHIYSMLGADLWEPAHTLSE-HDKIVTGVDWAPKSNRIVTCSHDRN 78 (361)
T ss_pred ccCceeeeeecCCCc---------eEEeccCCceEEEEEecCCCCceeceehhh-hCcceeEEeecCCCCceeEccCCCC
Confidence 347999999999998 89999999999999987665 5667777 9999999999999999999999999
Q ss_pred EEEEeCC-CCe--EEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCce--eE-Ee-ecCCCCeEEEEECCCC
Q 036605 97 ASEMKSE-MGE--VIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEE--VL-KF-SDDVGPLQYVSASDGA 167 (340)
Q Consensus 97 i~~wd~~-~~~--~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~--~~-~~-~~~~~~v~~~~~s~~~ 167 (340)
-++|... .++ +...+..+....+++.|+|.++.++++++. |.||-++.... +. .+ ..+.+.|.++.|+|++
T Consensus 79 ayVw~~~~~~~WkptlvLlRiNrAAt~V~WsP~enkFAVgSgar~isVcy~E~ENdWWVsKhikkPirStv~sldWhpnn 158 (361)
T KOG1523|consen 79 AYVWTQPSGGTWKPTLVLLRINRAATCVKWSPKENKFAVGSGARLISVCYYEQENDWWVSKHIKKPIRSTVTSLDWHPNN 158 (361)
T ss_pred ccccccCCCCeeccceeEEEeccceeeEeecCcCceEEeccCccEEEEEEEecccceehhhhhCCccccceeeeeccCCc
Confidence 9999984 333 333455678889999999999999997665 66666554321 11 11 3456789999999999
Q ss_pred CEEEEEEcCCCeEEEEEccCCC---CCc---------cCCceeee-cCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEE
Q 036605 168 KIIITAGYGEKHLQVWRCDISS---KTV---------NKGPALSM-RHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWD 234 (340)
Q Consensus 168 ~~l~s~~~~d~~i~iwd~~~~~---~~~---------~~~~~~~~-~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd 234 (340)
-.+++++. |+..+||..-... +.. ...+.... ....++..+ .| ++.|..|+-.+.|+.+.+-|
T Consensus 159 VLlaaGs~-D~k~rVfSayIK~Vdekpap~pWgsk~PFG~lm~E~~~~ggwvh~v--~f-s~sG~~lawv~Hds~v~~~d 234 (361)
T KOG1523|consen 159 VLLAAGST-DGKCRVFSAYIKGVDEKPAPTPWGSKMPFGQLMSEASSSGGWVHGV--LF-SPSGNRLAWVGHDSTVSFVD 234 (361)
T ss_pred ceeccccc-CcceeEEEEeeeccccCCCCCCCccCCcHHHHHHhhccCCCceeee--Ee-CCCCCEeeEecCCCceEEee
Confidence 88888766 9999999752111 100 00011111 234455556 66 89999999999999999999
Q ss_pred CCCCC
Q 036605 235 LKTVS 239 (340)
Q Consensus 235 ~~~~~ 239 (340)
.....
T Consensus 235 a~~p~ 239 (361)
T KOG1523|consen 235 AAGPS 239 (361)
T ss_pred cCCCc
Confidence 87765
No 161
>KOG1063 consensus RNA polymerase II elongator complex, subunit ELP2, WD repeat superfamily [Chromatin structure and dynamics; Transcription]
Probab=99.74 E-value=9.3e-17 Score=139.86 Aligned_cols=206 Identities=15% Similarity=0.089 Sum_probs=153.8
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEcCC-----CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEe
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSN-----GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVG 92 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~d-----g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~ 92 (340)
.+|...|.|++.+|+++ ++|+++.. ..|++|+..+-.....+.+ |.-.|+.++|+|||++|++++
T Consensus 522 YGHGyEv~~l~~s~~gn---------liASaCKS~~~ehAvI~lw~t~~W~~~~~L~~-HsLTVT~l~FSpdg~~LLsvs 591 (764)
T KOG1063|consen 522 YGHGYEVYALAISPTGN---------LIASACKSSLKEHAVIRLWNTANWLQVQELEG-HSLTVTRLAFSPDGRYLLSVS 591 (764)
T ss_pred ccCceeEEEEEecCCCC---------EEeehhhhCCccceEEEEEeccchhhhheecc-cceEEEEEEECCCCcEEEEee
Confidence 48999999999999999 99998765 4689999888877778888 999999999999999999999
Q ss_pred CCCcEEEEeCCCCeE----EEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCC--ceeEE--eecCCCCeEEEE
Q 036605 93 TNGMASEMKSEMGEV----IREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENG--EEVLK--FSDDVGPLQYVS 162 (340)
Q Consensus 93 ~dg~i~~wd~~~~~~----~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~--~~~~~--~~~~~~~v~~~~ 162 (340)
.|.++.+|....... ....+.|..-|.+..|+|++.++++++++ |++|..... +.+.. ...+...|+.++
T Consensus 592 RDRt~sl~~~~~~~~~e~~fa~~k~HtRIIWdcsW~pde~~FaTaSRDK~VkVW~~~~~~d~~i~~~a~~~~~~aVTAv~ 671 (764)
T KOG1063|consen 592 RDRTVSLYEVQEDIKDEFRFACLKAHTRIIWDCSWSPDEKYFATASRDKKVKVWEEPDLRDKYISRFACLKFSLAVTAVA 671 (764)
T ss_pred cCceEEeeeeecccchhhhhccccccceEEEEcccCcccceeEEecCCceEEEEeccCchhhhhhhhchhccCCceeeEE
Confidence 999999998754332 12356788899999999999999999888 999998877 44433 245678899998
Q ss_pred ECC----CCCEEEEEEcCCCeEEEEEccCCCCCccC--------CceeeecCCCeeeeeecCCC---------CCCCCEE
Q 036605 163 ASD----GAKIIITAGYGEKHLQVWRCDISSKTVNK--------GPALSMRHSPVAIDCKNSPN---------GEDGTVI 221 (340)
Q Consensus 163 ~s~----~~~~l~s~~~~d~~i~iwd~~~~~~~~~~--------~~~~~~~~~~~~~~~~~~~~---------~~~~~~l 221 (340)
+.| +..++++.|...|.|.+|...... ++.. ...-.+.+...+..+ .|. ..+...|
T Consensus 672 ~~~~~~~e~~~~vavGle~GeI~l~~~~~~~-~~~~~~~~~~~~~l~~~~~~~~aV~rl--~w~p~~~~~~~~~~~~l~l 748 (764)
T KOG1063|consen 672 YLPVDHNEKGDVVAVGLEKGEIVLWRRKREH-RQVTVGTFNLDTRLCATIGPDSAVNRL--LWRPTCSDDWVEDKEWLNL 748 (764)
T ss_pred eeccccccccceEEEEecccEEEEEeccccc-ccccceeeeeccccccccChHHhhhee--EeccccccccccccceeEE
Confidence 855 334467767779999999973111 1111 111111222233333 221 2334567
Q ss_pred EEEeCCCcEEEEECC
Q 036605 222 LAVAESGVAYSWDLK 236 (340)
Q Consensus 222 ~~~s~dg~i~vwd~~ 236 (340)
++|+.|..++++++.
T Consensus 749 a~~g~D~~vri~nv~ 763 (764)
T KOG1063|consen 749 AVGGDDESVRIFNVD 763 (764)
T ss_pred eeecccceeEEeecc
Confidence 999999999999874
No 162
>KOG4328 consensus WD40 protein [Function unknown]
Probab=99.74 E-value=1.8e-16 Score=131.88 Aligned_cols=209 Identities=15% Similarity=0.052 Sum_probs=158.5
Q ss_pred CCCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCe--eEEEecCCCCCCeEEEEEecCCCEEEEEeCCC
Q 036605 19 EPVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGE--MKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNG 95 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~--~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg 95 (340)
.|+.+|++|.|+|.. . .+++.+.||+|++-|++++. .+..+.. -...+..+.|+.+...++.++.=|
T Consensus 232 ~hs~~Vs~l~F~P~n~s---------~i~ssSyDGtiR~~D~~~~i~e~v~s~~~-d~~~fs~~d~~~e~~~vl~~~~~G 301 (498)
T KOG4328|consen 232 PHSGPVSGLKFSPANTS---------QIYSSSYDGTIRLQDFEGNISEEVLSLDT-DNIWFSSLDFSAESRSVLFGDNVG 301 (498)
T ss_pred cCCccccceEecCCChh---------heeeeccCceeeeeeecchhhHHHhhcCc-cceeeeeccccCCCccEEEeeccc
Confidence 789999999999988 4 69999999999999998764 2333332 344567888888888888888878
Q ss_pred cEEEEeCCCCeE-EEEeecCCCCeeEEEEccCCCEE-EEec--CcEEEEECCCCce----eEEeecCCCCeEEEEECCCC
Q 036605 96 MASEMKSEMGEV-IREFKASEKPISSSAFLCEEKIF-ALAS--SEVRILSLENGEE----VLKFSDDVGPLQYVSASDGA 167 (340)
Q Consensus 96 ~i~~wd~~~~~~-~~~~~~~~~~i~~l~~~~~~~~l-~~~~--~~i~i~d~~~~~~----~~~~~~~~~~v~~~~~s~~~ 167 (340)
...+||.+++.. ...+..|+..|.+++++|-..++ ++++ ++.+|||++.... +.....|.-.|.+..|||++
T Consensus 302 ~f~~iD~R~~~s~~~~~~lh~kKI~sv~~NP~~p~~laT~s~D~T~kIWD~R~l~~K~sp~lst~~HrrsV~sAyFSPs~ 381 (498)
T KOG4328|consen 302 NFNVIDLRTDGSEYENLRLHKKKITSVALNPVCPWFLATASLDQTAKIWDLRQLRGKASPFLSTLPHRRSVNSAYFSPSG 381 (498)
T ss_pred ceEEEEeecCCccchhhhhhhcccceeecCCCCchheeecccCcceeeeehhhhcCCCCcceecccccceeeeeEEcCCC
Confidence 999999998765 55677888899999999987665 5544 4499999976422 23446789999999999998
Q ss_pred CEEEEEEcCCCeEEEEEccCC-CCCccCCceeeecCC----CeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 168 KIIITAGYGEKHLQVWRCDIS-SKTVNKGPALSMRHS----PVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 168 ~~l~s~~~~d~~i~iwd~~~~-~~~~~~~~~~~~~~~----~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
-.|++.+. |..|+|||...- .... ....+.|. .+...+.+.| .|+..++++|..-..|-|||-..++.+.
T Consensus 382 gtl~TT~~-D~~IRv~dss~~sa~~~---p~~~I~Hn~~t~RwlT~fKA~W-~P~~~li~vg~~~r~IDv~~~~~~q~v~ 456 (498)
T KOG4328|consen 382 GTLLTTCQ-DNEIRVFDSSCISAKDE---PLGTIPHNNRTGRWLTPFKAAW-DPDYNLIVVGRYPRPIDVFDGNGGQMVC 456 (498)
T ss_pred CceEeecc-CCceEEeecccccccCC---ccceeeccCcccccccchhhee-CCCccEEEEeccCcceeEEcCCCCEEee
Confidence 88999888 999999996210 1111 11112332 3444555677 8999999999999999999998877443
No 163
>KOG2106 consensus Uncharacterized conserved protein, contains HELP and WD40 domains [Function unknown]
Probab=99.74 E-value=1.4e-15 Score=128.11 Aligned_cols=210 Identities=13% Similarity=0.135 Sum_probs=151.1
Q ss_pred ccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEE
Q 036605 2 WSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAF 81 (340)
Q Consensus 2 wd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~ 81 (340)
|++..|.+......-......-|.|++|.++|. +++|.++|.|.||+..+.+..+.... |.+.|.+++.
T Consensus 227 w~~~~~~l~k~~~~fek~ekk~Vl~v~F~engd----------viTgDS~G~i~Iw~~~~~~~~k~~~a-H~ggv~~L~~ 295 (626)
T KOG2106|consen 227 WTLRGGSLVKRQGIFEKREKKFVLCVTFLENGD----------VITGDSGGNILIWSKGTNRISKQVHA-HDGGVFSLCM 295 (626)
T ss_pred EEccCCceEEEeeccccccceEEEEEEEcCCCC----------EEeecCCceEEEEeCCCceEEeEeee-cCCceEEEEE
Confidence 777777655322111123347899999999999 99999999999999988777766664 9999999999
Q ss_pred ecCCCEEEEEeCCCcEEEEeCCCCe----------------------E------------------EEEeecCCCCeeEE
Q 036605 82 AKKGRSLHVVGTNGMASEMKSEMGE----------------------V------------------IREFKASEKPISSS 121 (340)
Q Consensus 82 ~~~~~~l~s~~~dg~i~~wd~~~~~----------------------~------------------~~~~~~~~~~i~~l 121 (340)
..+|.+|- |+.|..|..||-.-.+ . .....+|......+
T Consensus 296 lr~GtllS-GgKDRki~~Wd~~y~k~r~~elPe~~G~iRtv~e~~~di~vGTtrN~iL~Gt~~~~f~~~v~gh~delwgl 374 (626)
T KOG2106|consen 296 LRDGTLLS-GGKDRKIILWDDNYRKLRETELPEQFGPIRTVAEGKGDILVGTTRNFILQGTLENGFTLTVQGHGDELWGL 374 (626)
T ss_pred ecCccEee-cCccceEEeccccccccccccCchhcCCeeEEecCCCcEEEeeccceEEEeeecCCceEEEEecccceeeE
Confidence 98886554 9999999999832100 0 01123566677889
Q ss_pred EEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceee
Q 036605 122 AFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALS 199 (340)
Q Consensus 122 ~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~ 199 (340)
+.+|+...+++++.+ +++|+ ..+.+... .-..++.++.|+|.| .++.+.. .|...+.|. .+........
T Consensus 375 a~hps~~q~~T~gqdk~v~lW~--~~k~~wt~-~~~d~~~~~~fhpsg-~va~Gt~-~G~w~V~d~--e~~~lv~~~~-- 445 (626)
T KOG2106|consen 375 ATHPSKNQLLTCGQDKHVRLWN--DHKLEWTK-IIEDPAECADFHPSG-VVAVGTA-TGRWFVLDT--ETQDLVTIHT-- 445 (626)
T ss_pred EcCCChhheeeccCcceEEEcc--CCceeEEE-EecCceeEeeccCcc-eEEEeec-cceEEEEec--ccceeEEEEe--
Confidence 999999989887766 99999 33333222 234678899999999 7777665 899999998 4433222222
Q ss_pred ecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 200 MRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 200 ~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
. ......+ .+ +|+|.+|+.|+.|+.|++|.+..
T Consensus 446 -d-~~~ls~v--~y-sp~G~~lAvgs~d~~iyiy~Vs~ 478 (626)
T KOG2106|consen 446 -D-NEQLSVV--RY-SPDGAFLAVGSHDNHIYIYRVSA 478 (626)
T ss_pred -c-CCceEEE--EE-cCCCCEEEEecCCCeEEEEEECC
Confidence 2 2222222 33 89999999999999999998876
No 164
>KOG1538 consensus Uncharacterized conserved protein WDR10, contains WD40 repeats [General function prediction only]
Probab=99.73 E-value=3.1e-16 Score=136.35 Aligned_cols=211 Identities=17% Similarity=0.183 Sum_probs=153.6
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEec-----------
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKST----------- 69 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~----------- 69 (340)
|||++.|.++.+++ +|...|.|++|+.||+ .+|+|+.|..|.+|+.+-...+ ++.
T Consensus 37 iyD~ndG~llqtLK----gHKDtVycVAys~dGk---------rFASG~aDK~VI~W~~klEG~L-kYSH~D~IQCMsFN 102 (1081)
T KOG1538|consen 37 VYDTSDGTLLQPLK----GHKDTVYCVAYAKDGK---------RFASGSADKSVIIWTSKLEGIL-KYSHNDAIQCMSFN 102 (1081)
T ss_pred EEeCCCcccccccc----cccceEEEEEEccCCc---------eeccCCCceeEEEeccccccee-eeccCCeeeEeecC
Confidence 68999999999998 9999999999999999 8999999999999985422111 110
Q ss_pred -------------------------C-CCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEee---cCCCCeeE
Q 036605 70 -------------------------G-RHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFK---ASEKPISS 120 (340)
Q Consensus 70 -------------------------~-~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~---~~~~~i~~ 120 (340)
. .....|.+.+|..||++|+.|-.+|+|.+-+- +++....+. +...+|.+
T Consensus 103 P~~h~LasCsLsdFglWS~~qK~V~K~kss~R~~~CsWtnDGqylalG~~nGTIsiRNk-~gEek~~I~Rpgg~Nspiws 181 (1081)
T KOG1538|consen 103 PITHQLASCSLSDFGLWSPEQKSVSKHKSSSRIICCSWTNDGQYLALGMFNGTISIRNK-NGEEKVKIERPGGSNSPIWS 181 (1081)
T ss_pred chHHHhhhcchhhccccChhhhhHHhhhhheeEEEeeecCCCcEEEEeccCceEEeecC-CCCcceEEeCCCCCCCCceE
Confidence 0 01235677788888888888888888888753 455444444 36778999
Q ss_pred EEEccCC-----CEEEE--ecCcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCcc
Q 036605 121 SAFLCEE-----KIFAL--ASSEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVN 193 (340)
Q Consensus 121 l~~~~~~-----~~l~~--~~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~ 193 (340)
++|+|.. ..+++ .+.++.+|.+.. +.+.+-..-.....++.+-++|.|++.+|. |+.+.+|-- .+-..
T Consensus 182 i~~~p~sg~G~~di~aV~DW~qTLSFy~LsG-~~Igk~r~L~FdP~CisYf~NGEy~LiGGs-dk~L~~fTR---~GvrL 256 (1081)
T KOG1538|consen 182 ICWNPSSGEGRNDILAVADWGQTLSFYQLSG-KQIGKDRALNFDPCCISYFTNGEYILLGGS-DKQLSLFTR---DGVRL 256 (1081)
T ss_pred EEecCCCCCCccceEEEEeccceeEEEEecc-eeecccccCCCCchhheeccCCcEEEEccC-CCceEEEee---cCeEE
Confidence 9999964 34444 344477777653 344333334455678999999999999999 999999974 34333
Q ss_pred CCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 194 KGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 194 ~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
.... ....+++.+ .. .|++++++.|+.||+|-.|++..
T Consensus 257 GTvg---~~D~WIWtV--~~-~PNsQ~v~~GCqDGTiACyNl~f 294 (1081)
T KOG1538|consen 257 GTVG---EQDSWIWTV--QA-KPNSQYVVVGCQDGTIACYNLIF 294 (1081)
T ss_pred eecc---ccceeEEEE--EE-ccCCceEEEEEccCeeehhhhHH
Confidence 3333 344455555 44 89999999999999999998754
No 165
>KOG2445 consensus Nuclear pore complex component (sc Seh1) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=99.73 E-value=9.9e-16 Score=121.52 Aligned_cols=220 Identities=13% Similarity=0.228 Sum_probs=149.7
Q ss_pred CccCC--CC--ceeeeeeCCCCCCCCCeEEEEeecc--ccccccccCceEEEEEcCCCcEEEEEccCC-------e--eE
Q 036605 1 IWSTN--DG--SLLAEWKQPDGEPVVSYSCLACGFV--GKKRRKERGTLLLALGTSNGDILAVDVLTG-------E--MK 65 (340)
Q Consensus 1 vwd~~--~g--~~~~~~~~~~~~~~~~v~~l~~sp~--~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~-------~--~~ 65 (340)
|||.. +| .+...++ .|++.|..+.|.+. |+ .+|+++.|+++.||.-... + ..
T Consensus 39 I~d~~~~s~~W~~Ts~Wr----ah~~Si~rV~WAhPEfGq---------vvA~cS~Drtv~iWEE~~~~~~~~~~~Wv~~ 105 (361)
T KOG2445|consen 39 IWDSTSDSGTWSCTSSWR----AHDGSIWRVVWAHPEFGQ---------VVATCSYDRTVSIWEEQEKSEEAHGRRWVRR 105 (361)
T ss_pred EEeccCCCCceEEeeeEE----ecCCcEEEEEecCccccc---------eEEEEecCCceeeeeecccccccccceeEEE
Confidence 56643 23 3446676 89999999999655 47 8999999999999974211 1 23
Q ss_pred EEecCCCCCCeEEEEEec--CCCEEEEEeCCCcEEEEeCCCCeEEEE------ee-------cCCCCeeEEEEccC---C
Q 036605 66 WKSTGRHPGGLAGLAFAK--KGRSLHVVGTNGMASEMKSEMGEVIRE------FK-------ASEKPISSSAFLCE---E 127 (340)
Q Consensus 66 ~~~~~~h~~~v~~v~~~~--~~~~l~s~~~dg~i~~wd~~~~~~~~~------~~-------~~~~~i~~l~~~~~---~ 127 (340)
.++.. ..+.|+++.|.| -|-.|++++.||.+++|+...--.+.. +. .+..+..|+.|+|. .
T Consensus 106 ttl~D-srssV~DV~FaP~hlGLklA~~~aDG~lRIYEA~dp~nLs~W~Lq~Ei~~~~~pp~~~~~~~~CvsWn~sr~~~ 184 (361)
T KOG2445|consen 106 TTLVD-SRSSVTDVKFAPKHLGLKLAAASADGILRIYEAPDPMNLSQWTLQHEIQNVIDPPGKNKQPCFCVSWNPSRMHE 184 (361)
T ss_pred EEeec-CCcceeEEEecchhcceEEEEeccCcEEEEEecCCccccccchhhhhhhhccCCcccccCcceEEeeccccccC
Confidence 34455 677999999998 466899999999999998764332222 22 34556789999975 3
Q ss_pred CEEEEecC-------cEEEEECCCC----ceeEEeecCCCCeEEEEECCCC---CEEEEEEcCCCeEEEEEccCCC----
Q 036605 128 KIFALASS-------EVRILSLENG----EEVLKFSDDVGPLQYVSASDGA---KIIITAGYGEKHLQVWRCDISS---- 189 (340)
Q Consensus 128 ~~l~~~~~-------~i~i~d~~~~----~~~~~~~~~~~~v~~~~~s~~~---~~l~s~~~~d~~i~iwd~~~~~---- 189 (340)
.+++++.. +++||....+ ..+.++.+|..+|+.++|.|+- .++++.+..|| |+||.+....
T Consensus 185 p~iAvgs~e~a~~~~~~~Iye~~e~~rKw~kva~L~d~~dpI~di~wAPn~Gr~y~~lAvA~kDg-v~I~~v~~~~s~i~ 263 (361)
T KOG2445|consen 185 PLIAVGSDEDAPHLNKVKIYEYNENGRKWLKVAELPDHTDPIRDISWAPNIGRSYHLLAVATKDG-VRIFKVKVARSAIE 263 (361)
T ss_pred ceEEEEcccCCccccceEEEEecCCcceeeeehhcCCCCCcceeeeeccccCCceeeEEEeecCc-EEEEEEeeccchhh
Confidence 56666433 3888876543 2346678999999999999972 24444455589 9999995211
Q ss_pred ------CCcc-----CCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 190 ------KTVN-----KGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 190 ------~~~~-----~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
.... ..+...-.|...+..+ .| .-.|..|.+.+.||.|++|...-.
T Consensus 264 ~ee~~~~~~~~~l~v~~vs~~~~H~~~VWrv--~w-NmtGtiLsStGdDG~VRLWkany~ 320 (361)
T KOG2445|consen 264 EEEVLAPDLMTDLPVEKVSELDDHNGEVWRV--RW-NMTGTILSSTGDDGCVRLWKANYN 320 (361)
T ss_pred hhcccCCCCccccceEEeeeccCCCCceEEE--EE-eeeeeEEeecCCCceeeehhhhhh
Confidence 0000 0111111455556665 66 677899999999999999976543
No 166
>KOG0321 consensus WD40 repeat-containing protein L2DTL [Function unknown]
Probab=99.73 E-value=2.3e-16 Score=136.23 Aligned_cols=196 Identities=13% Similarity=0.196 Sum_probs=137.7
Q ss_pred EEEEEcCCCcEEEEEccCCeeE------EEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEE--eecCC
Q 036605 44 LLALGTSNGDILAVDVLTGEMK------WKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIRE--FKASE 115 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~------~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~--~~~~~ 115 (340)
+||.+..+|.|.++|....... ..+. .|...|..+.|.|....|++++.|.++++||+.+++.... +.+|.
T Consensus 66 iLavadE~G~i~l~dt~~~~fr~ee~~lk~~~-aH~nAifDl~wapge~~lVsasGDsT~r~Wdvk~s~l~G~~~~~GH~ 144 (720)
T KOG0321|consen 66 ILAVADEDGGIILFDTKSIVFRLEERQLKKPL-AHKNAIFDLKWAPGESLLVSASGDSTIRPWDVKTSRLVGGRLNLGHT 144 (720)
T ss_pred eEEEecCCCceeeecchhhhcchhhhhhcccc-cccceeEeeccCCCceeEEEccCCceeeeeeeccceeecceeecccc
Confidence 7999999999999997654322 2334 4999999999999777899999999999999999988776 88999
Q ss_pred CCeeEEEEccCCCEEEE-ecCc--EEEEECCCCce---------------------------eEEeecCCCCeEE---EE
Q 036605 116 KPISSSAFLCEEKIFAL-ASSE--VRILSLENGEE---------------------------VLKFSDDVGPLQY---VS 162 (340)
Q Consensus 116 ~~i~~l~~~~~~~~l~~-~~~~--i~i~d~~~~~~---------------------------~~~~~~~~~~v~~---~~ 162 (340)
..+.+++|.|....+++ |+++ |.|||++-... +.....+...|.+ +.
T Consensus 145 ~SvkS~cf~~~n~~vF~tGgRDg~illWD~R~n~~d~~e~~~~~~~~~~n~~ptpskp~~kr~~k~kA~s~ti~ssvTvv 224 (720)
T KOG0321|consen 145 GSVKSECFMPTNPAVFCTGGRDGEILLWDCRCNGVDALEEFDNRIYGRHNTAPTPSKPLKKRIRKWKAASNTIFSSVTVV 224 (720)
T ss_pred cccchhhhccCCCcceeeccCCCcEEEEEEeccchhhHHHHhhhhhccccCCCCCCchhhccccccccccCceeeeeEEE
Confidence 99999999998876654 5555 99999864320 1112233344444 45
Q ss_pred ECCCCCEEEEEEcCCCeEEEEEccCCCC----CccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 163 ASDGAKIIITAGYGEKHLQVWRCDISSK----TVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 163 ~s~~~~~l~s~~~~d~~i~iwd~~~~~~----~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
+..|...|++++..|+.|+|||++.... +......+. .+......+.+......|.+|++.+.|+.|++|++...
T Consensus 225 ~fkDe~tlaSaga~D~~iKVWDLRk~~~~~r~ep~~~~~~~-t~skrs~G~~nL~lDssGt~L~AsCtD~sIy~ynm~s~ 303 (720)
T KOG0321|consen 225 LFKDESTLASAGAADSTIKVWDLRKNYTAYRQEPRGSDKYP-THSKRSVGQVNLILDSSGTYLFASCTDNSIYFYNMRSL 303 (720)
T ss_pred EEeccceeeeccCCCcceEEEeecccccccccCCCcccCcc-CcccceeeeEEEEecCCCCeEEEEecCCcEEEEecccc
Confidence 5566778888888899999999974331 111111111 11111222222222566788988889999999999875
Q ss_pred Ccc
Q 036605 239 SQD 241 (340)
Q Consensus 239 ~~~ 241 (340)
..-
T Consensus 304 s~s 306 (720)
T KOG0321|consen 304 SIS 306 (720)
T ss_pred CcC
Confidence 443
No 167
>KOG1009 consensus Chromatin assembly complex 1 subunit B/CAC2 (contains WD40 repeats) [Chromatin structure and dynamics; Replication, recombination and repair]
Probab=99.72 E-value=1.3e-16 Score=130.75 Aligned_cols=157 Identities=15% Similarity=0.111 Sum_probs=131.8
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe---------eEEEecCCCCCCeEEEEEecCCCEEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE---------MKWKSTGRHPGGLAGLAFAKKGRSLH 89 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~---------~~~~~~~~h~~~v~~v~~~~~~~~l~ 89 (340)
|...+|..+.|.++.. ..||+|+.|..|++|-+..+. .+..+.. |...|+++.|+|+|..|+
T Consensus 11 H~~~pv~s~dfq~n~~--------~~laT~G~D~~iriW~v~r~~~~~~~~~V~y~s~Ls~-H~~aVN~vRf~p~gelLA 81 (434)
T KOG1009|consen 11 HDHEPVYSVDFQKNSL--------NKLATAGGDKDIRIWKVNRSEPGGGDMKVEYLSSLSR-HTRAVNVVRFSPDGELLA 81 (434)
T ss_pred cCCCceEEEEeccCcc--------cceecccCccceeeeeeeecCCCCCceeEEEeecccC-CcceeEEEEEcCCcCeee
Confidence 4557899999988763 179999999999999876532 2334555 999999999999999999
Q ss_pred EEeCCCcEEEEeCC--------C--------CeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEe
Q 036605 90 VVGTNGMASEMKSE--------M--------GEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKF 151 (340)
Q Consensus 90 s~~~dg~i~~wd~~--------~--------~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~ 151 (340)
+|+++|.|.+|-.. + ......+.+|...++.++|+|++.+++++..+ +++||+..|..+..+
T Consensus 82 Sg~D~g~v~lWk~~~~~~~~~d~e~~~~ke~w~v~k~lr~h~~diydL~Ws~d~~~l~s~s~dns~~l~Dv~~G~l~~~~ 161 (434)
T KOG1009|consen 82 SGGDGGEVFLWKQGDVRIFDADTEADLNKEKWVVKKVLRGHRDDIYDLAWSPDSNFLVSGSVDNSVRLWDVHAGQLLAIL 161 (434)
T ss_pred ecCCCceEEEEEecCcCCccccchhhhCccceEEEEEecccccchhhhhccCCCceeeeeeccceEEEEEeccceeEeec
Confidence 99999999999765 2 12334466788999999999999999885544 999999999999999
Q ss_pred ecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 152 SDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 152 ~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
..|...+..++|.|.++|+++-+. |+..+++++
T Consensus 162 ~dh~~yvqgvawDpl~qyv~s~s~-dr~~~~~~~ 194 (434)
T KOG1009|consen 162 DDHEHYVQGVAWDPLNQYVASKSS-DRHPEGFSA 194 (434)
T ss_pred cccccccceeecchhhhhhhhhcc-Ccccceeee
Confidence 999999999999999999999877 887777776
No 168
>KOG0642 consensus Cell-cycle nuclear protein, contains WD-40 repeats [Cell cycle control, cell division, chromosome partitioning]
Probab=99.71 E-value=3.5e-16 Score=133.40 Aligned_cols=200 Identities=12% Similarity=0.131 Sum_probs=153.2
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC--------CeeEEEecCCCCCCeEEEEEecCCCEEEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT--------GEMKWKSTGRHPGGLAGLAFAKKGRSLHV 90 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~--------~~~~~~~~~~h~~~v~~v~~~~~~~~l~s 90 (340)
.|...++.++|+|... .|++++.||+|.+|+++. -+.+++|.+ |.++|.|++..+.+..+++
T Consensus 292 s~~d~ir~l~~~~sep---------~lit~sed~~lk~WnLqk~~~s~~~~~epi~tfra-H~gPVl~v~v~~n~~~~ys 361 (577)
T KOG0642|consen 292 SHDDCIRALAFHPSEP---------VLITASEDGTLKLWNLQKAKKSAEKDVEPILTFRA-HEGPVLCVVVPSNGEHCYS 361 (577)
T ss_pred cchhhhhhhhcCCCCC---------eEEEeccccchhhhhhcccCCccccceeeeEEEec-ccCceEEEEecCCceEEEe
Confidence 5778889999998887 899999999999999932 236778888 9999999999999999999
Q ss_pred EeCCCcEEEEeCCCC----------eEEEEeecCCCCeeEEEEccCCCEEEEe--cCcEEEEECCCCceeEEeec-----
Q 036605 91 VGTNGMASEMKSEMG----------EVIREFKASEKPISSSAFLCEEKIFALA--SSEVRILSLENGEEVLKFSD----- 153 (340)
Q Consensus 91 ~~~dg~i~~wd~~~~----------~~~~~~~~~~~~i~~l~~~~~~~~l~~~--~~~i~i~d~~~~~~~~~~~~----- 153 (340)
|+-||.|+.|++... .....+.+|...++.+++|+....|+++ ++++++|+.....+ ..|..
T Consensus 362 gg~Dg~I~~w~~p~n~dp~ds~dp~vl~~~l~Ghtdavw~l~~s~~~~~Llscs~DgTvr~w~~~~~~~-~~f~~~~e~g 440 (577)
T KOG0642|consen 362 GGIDGTIRCWNLPPNQDPDDSYDPSVLSGTLLGHTDAVWLLALSSTKDRLLSCSSDGTVRLWEPTEESP-CTFGEPKEHG 440 (577)
T ss_pred eccCceeeeeccCCCCCcccccCcchhccceeccccceeeeeecccccceeeecCCceEEeeccCCcCc-cccCCccccC
Confidence 999999999965421 1234577899999999999988888775 77799998754433 11100
Q ss_pred -----------------------------------------------CCCCeEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 154 -----------------------------------------------DVGPLQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 154 -----------------------------------------------~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
....+..+...|.+...+++.. |+.|+++|.
T Consensus 441 ~Plsvd~~ss~~a~~~~s~~~~~~~~~~~ev~s~~~~~~s~~~~~~~~~~~in~vVs~~~~~~~~~~he-d~~Ir~~dn- 518 (577)
T KOG0642|consen 441 YPLSVDRTSSRPAHSLASFRFGYTSIDDMEVVSDLLIFESSASPGPRRYPQINKVVSHPTADITFTAHE-DRSIRFFDN- 518 (577)
T ss_pred CcceEeeccchhHhhhhhcccccccchhhhhhhheeeccccCCCcccccCccceEEecCCCCeeEeccc-CCceecccc-
Confidence 0023455666777777777666 999999998
Q ss_pred CCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 187 ISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 187 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
.++..+.... .|...+..+ .+ .++|.+|++++.||.+++|.+...
T Consensus 519 -~~~~~l~s~~---a~~~svtsl--ai-~~ng~~l~s~s~d~sv~l~kld~k 563 (577)
T KOG0642|consen 519 -KTGKILHSMV---AHKDSVTSL--AI-DPNGPYLMSGSHDGSVRLWKLDVK 563 (577)
T ss_pred -cccccchhee---eccceecce--ee-cCCCceEEeecCCceeehhhccch
Confidence 5566555554 455444444 44 799999999999999999998653
No 169
>KOG2106 consensus Uncharacterized conserved protein, contains HELP and WD40 domains [Function unknown]
Probab=99.71 E-value=3.8e-15 Score=125.57 Aligned_cols=214 Identities=15% Similarity=0.125 Sum_probs=153.4
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe-----------eE----
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE-----------MK---- 65 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~-----------~~---- 65 (340)
||+..+.+..++.. .|...|.||+.-.+|. |++|+.|..|..||-.-.+ .+
T Consensus 271 Iw~~~~~~~~k~~~----aH~ggv~~L~~lr~Gt----------llSGgKDRki~~Wd~~y~k~r~~elPe~~G~iRtv~ 336 (626)
T KOG2106|consen 271 IWSKGTNRISKQVH----AHDGGVFSLCMLRDGT----------LLSGGKDRKIILWDDNYRKLRETELPEQFGPIRTVA 336 (626)
T ss_pred EEeCCCceEEeEee----ecCCceEEEEEecCcc----------EeecCccceEEeccccccccccccCchhcCCeeEEe
Confidence 46665555554444 6899999999999999 6669999999999821000 00
Q ss_pred -------------------------EEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeE
Q 036605 66 -------------------------WKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISS 120 (340)
Q Consensus 66 -------------------------~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~ 120 (340)
....+ |......++.+|+..++++++.|+.+++|+ ..+++.... -..+..|
T Consensus 337 e~~~di~vGTtrN~iL~Gt~~~~f~~~v~g-h~delwgla~hps~~q~~T~gqdk~v~lW~--~~k~~wt~~-~~d~~~~ 412 (626)
T KOG2106|consen 337 EGKGDILVGTTRNFILQGTLENGFTLTVQG-HGDELWGLATHPSKNQLLTCGQDKHVRLWN--DHKLEWTKI-IEDPAEC 412 (626)
T ss_pred cCCCcEEEeeccceEEEeeecCCceEEEEe-cccceeeEEcCCChhheeeccCcceEEEcc--CCceeEEEE-ecCceeE
Confidence 01123 777889999999999999999999999999 344443322 3567899
Q ss_pred EEEccCCCEEEEe--cCcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCcee
Q 036605 121 SAFLCEEKIFALA--SSEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPAL 198 (340)
Q Consensus 121 l~~~~~~~~l~~~--~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~ 198 (340)
+.|+|.| .++.+ .+...+.|.++...+..-.. ..+++.++|+|+|.+|+.++. |+.|+||.++. .+........
T Consensus 413 ~~fhpsg-~va~Gt~~G~w~V~d~e~~~lv~~~~d-~~~ls~v~ysp~G~~lAvgs~-d~~iyiy~Vs~-~g~~y~r~~k 488 (626)
T KOG2106|consen 413 ADFHPSG-VVAVGTATGRWFVLDTETQDLVTIHTD-NEQLSVVRYSPDGAFLAVGSH-DNHIYIYRVSA-NGRKYSRVGK 488 (626)
T ss_pred eeccCcc-eEEEeeccceEEEEecccceeEEEEec-CCceEEEEEcCCCCEEEEecC-CCeEEEEEECC-CCcEEEEeee
Confidence 9999999 66664 44488899988655444344 889999999999999999776 99999999953 3332222221
Q ss_pred eecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCcc
Q 036605 199 SMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQD 241 (340)
Q Consensus 199 ~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~ 241 (340)
.+...+..+ -| ++|++++.+-+.|-.|..|.-...++.
T Consensus 489 --~~gs~ithL--Dw-S~Ds~~~~~~S~d~eiLyW~~~~~~~~ 526 (626)
T KOG2106|consen 489 --CSGSPITHL--DW-SSDSQFLVSNSGDYEILYWKPSECKQI 526 (626)
T ss_pred --ecCceeEEe--ee-cCCCceEEeccCceEEEEEccccCccc
Confidence 111233333 45 899999999999999999944444433
No 170
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=99.71 E-value=2.5e-15 Score=115.58 Aligned_cols=198 Identities=15% Similarity=0.152 Sum_probs=138.3
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC---------Ce-eEEEecCCCCCCeEEEEEecCCCEEEEEe
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT---------GE-MKWKSTGRHPGGLAGLAFAKKGRSLHVVG 92 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~---------~~-~~~~~~~~h~~~v~~v~~~~~~~~l~s~~ 92 (340)
.|..-+|+|.++ +|++|..+|+|.++.+.. ++ .+...++ |.++|+.++|. ...|++|+
T Consensus 12 tvf~qa~sp~~~---------~l~agn~~G~iav~sl~sl~s~sa~~~gk~~iv~eqa-hdgpiy~~~f~--d~~Lls~g 79 (325)
T KOG0649|consen 12 TVFAQAISPSKQ---------YLFAGNLFGDIAVLSLKSLDSGSAEPPGKLKIVPEQA-HDGPIYYLAFH--DDFLLSGG 79 (325)
T ss_pred HHHHHhhCCcce---------EEEEecCCCeEEEEEehhhhccccCCCCCcceeeccc-cCCCeeeeeee--hhheeecc
Confidence 456678999999 999999999999998753 22 2333355 99999999998 45777765
Q ss_pred CCCcEEEEeCCCCeE------EEEee--c-----CCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCC
Q 036605 93 TNGMASEMKSEMGEV------IREFK--A-----SEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGP 157 (340)
Q Consensus 93 ~dg~i~~wd~~~~~~------~~~~~--~-----~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~ 157 (340)
||.|+-|..+.... +.+.. . .--.|+++.+.|....++.++++ ++.||+++|+..+.+++|...
T Consensus 80 -dG~V~gw~W~E~~es~~~K~lwe~~~P~~~~~~evPeINam~ldP~enSi~~AgGD~~~y~~dlE~G~i~r~~rGHtDY 158 (325)
T KOG0649|consen 80 -DGLVYGWEWNEEEESLATKRLWEVKIPMQVDAVEVPEINAMWLDPSENSILFAGGDGVIYQVDLEDGRIQREYRGHTDY 158 (325)
T ss_pred -CceEEEeeehhhhhhccchhhhhhcCccccCcccCCccceeEeccCCCcEEEecCCeEEEEEEecCCEEEEEEcCCcce
Confidence 49999987653221 11110 1 11257889999887776665555 999999999999999999999
Q ss_pred eEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCcee-------eecCCCeeeeeecCCCCCCCCEEEEEeCCCcE
Q 036605 158 LQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPAL-------SMRHSPVAIDCKNSPNGEDGTVILAVAESGVA 230 (340)
Q Consensus 158 v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~-------~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i 230 (340)
+.++.--.....+++++. ||+++|||++ +++....+.. ......++..+ .-+..++++|+.- .+
T Consensus 159 vH~vv~R~~~~qilsG~E-DGtvRvWd~k--t~k~v~~ie~yk~~~~lRp~~g~wigal-----a~~edWlvCGgGp-~l 229 (325)
T KOG0649|consen 159 VHSVVGRNANGQILSGAE-DGTVRVWDTK--TQKHVSMIEPYKNPNLLRPDWGKWIGAL-----AVNEDWLVCGGGP-KL 229 (325)
T ss_pred eeeeeecccCcceeecCC-CccEEEEecc--ccceeEEeccccChhhcCcccCceeEEE-----eccCceEEecCCC-ce
Confidence 999998566668999888 9999999994 3332222110 00112223333 3455677777655 49
Q ss_pred EEEECCCCCccC
Q 036605 231 YSWDLKTVSQDE 242 (340)
Q Consensus 231 ~vwd~~~~~~~~ 242 (340)
.+|.++..+...
T Consensus 230 slwhLrsse~t~ 241 (325)
T KOG0649|consen 230 SLWHLRSSESTC 241 (325)
T ss_pred eEEeccCCCceE
Confidence 999998865544
No 171
>KOG1524 consensus WD40 repeat-containing protein CHE-2 [General function prediction only]
Probab=99.71 E-value=2e-16 Score=134.20 Aligned_cols=193 Identities=14% Similarity=0.220 Sum_probs=149.7
Q ss_pred ccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEE
Q 036605 31 FVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIRE 110 (340)
Q Consensus 31 p~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~ 110 (340)
+.++..+++.+.+.|+.+++||.+.|.+ +.++....+.. |.+.|.+-.|+|||.-|++++.||.|++|. ++|.....
T Consensus 64 ~~~rs~~~g~~~d~~~i~s~DGkf~il~-k~~rVE~sv~A-H~~A~~~gRW~~dGtgLlt~GEDG~iKiWS-rsGMLRSt 140 (737)
T KOG1524|consen 64 LGGRSSGGGKGSDTLLICSNDGRFVILN-KSARVERSISA-HAAAISSGRWSPDGAGLLTAGEDGVIKIWS-RSGMLRST 140 (737)
T ss_pred ccccccCCCCCcceEEEEcCCceEEEec-ccchhhhhhhh-hhhhhhhcccCCCCceeeeecCCceEEEEe-ccchHHHH
Confidence 3344445566788999999999999988 45666666676 999999999999999999999999999998 45655555
Q ss_pred eecCCCCeeEEEEccCCCEE-EEecCcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCC
Q 036605 111 FKASEKPISSSAFLCEEKIF-ALASSEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISS 189 (340)
Q Consensus 111 ~~~~~~~i~~l~~~~~~~~l-~~~~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~ 189 (340)
+.....+|+|++|.|+...+ ++.++.+.|=.+.....+..++.|.+-|.++.|++.+..++++|. |-..+|||- .
T Consensus 141 l~Q~~~~v~c~~W~p~S~~vl~c~g~h~~IKpL~~n~k~i~WkAHDGiiL~~~W~~~s~lI~sgGE-D~kfKvWD~---~ 216 (737)
T KOG1524|consen 141 VVQNEESIRCARWAPNSNSIVFCQGGHISIKPLAANSKIIRWRAHDGLVLSLSWSTQSNIIASGGE-DFRFKIWDA---Q 216 (737)
T ss_pred HhhcCceeEEEEECCCCCceEEecCCeEEEeecccccceeEEeccCcEEEEeecCccccceeecCC-ceeEEeecc---c
Confidence 55667789999999987655 556666888888888788899999999999999999999999888 999999995 2
Q ss_pred CCccC--------C------------------ceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEE
Q 036605 190 KTVNK--------G------------------PALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSW 233 (340)
Q Consensus 190 ~~~~~--------~------------------~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vw 233 (340)
+..+. . ..+.-.....++.+ +| ++||..+++|+..|.+.+-
T Consensus 217 G~~Lf~S~~~ey~ITSva~npd~~~~v~S~nt~R~~~p~~GSifnl--sW-S~DGTQ~a~gt~~G~v~~A 283 (737)
T KOG1524|consen 217 GANLFTSAAEEYAITSVAFNPEKDYLLWSYNTARFSSPRVGSIFNL--SW-SADGTQATCGTSTGQLIVA 283 (737)
T ss_pred CcccccCChhccceeeeeeccccceeeeeeeeeeecCCCccceEEE--EE-cCCCceeeccccCceEEEe
Confidence 22111 0 00111122334444 67 8999999999999987654
No 172
>KOG1445 consensus Tumor-specific antigen (contains WD repeats) [Cytoskeleton]
Probab=99.71 E-value=1.5e-16 Score=137.54 Aligned_cols=204 Identities=13% Similarity=0.108 Sum_probs=148.4
Q ss_pred CCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCe-------eEEEecCCCCCCeEEEEEec-CCCEEEE
Q 036605 20 PVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGE-------MKWKSTGRHPGGLAGLAFAK-KGRSLHV 90 (340)
Q Consensus 20 ~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~-------~~~~~~~~h~~~v~~v~~~~-~~~~l~s 90 (340)
....|+.++|.|-. . .||+++.||.|++|.+..+. ....+.. |...|+++.|+| -...|++
T Consensus 626 Ngt~vtDl~WdPFD~~---------rLAVa~ddg~i~lWr~~a~gl~e~~~tPe~~lt~-h~eKI~slRfHPLAadvLa~ 695 (1012)
T KOG1445|consen 626 NGTLVTDLHWDPFDDE---------RLAVATDDGQINLWRLTANGLPENEMTPEKILTI-HGEKITSLRFHPLAADVLAV 695 (1012)
T ss_pred cCceeeecccCCCChH---------HeeecccCceEEEEEeccCCCCcccCCcceeeec-ccceEEEEEecchhhhHhhh
Confidence 44679999999977 5 69999999999999987653 3345566 999999999999 4558899
Q ss_pred EeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEe--cCcEEEEECCCCcee-EEeecCC-CCeEEEEECCC
Q 036605 91 VGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALA--SSEVRILSLENGEEV-LKFSDDV-GPLQYVSASDG 166 (340)
Q Consensus 91 ~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~--~~~i~i~d~~~~~~~-~~~~~~~-~~v~~~~~s~~ 166 (340)
++.|.+|++||+.+++....+.+|.+.|..++|+|+|+.+++. ++.|++|..++++.. +.=.+.. ..-..+.|.-+
T Consensus 696 asyd~Ti~lWDl~~~~~~~~l~gHtdqIf~~AWSpdGr~~AtVcKDg~~rVy~Prs~e~pv~Eg~gpvgtRgARi~wacd 775 (1012)
T KOG1445|consen 696 ASYDSTIELWDLANAKLYSRLVGHTDQIFGIAWSPDGRRIATVCKDGTLRVYEPRSREQPVYEGKGPVGTRGARILWACD 775 (1012)
T ss_pred hhccceeeeeehhhhhhhheeccCcCceeEEEECCCCcceeeeecCceEEEeCCCCCCCccccCCCCccCcceeEEEEec
Confidence 9999999999999999999999999999999999999999884 555999998876432 2212111 23356788889
Q ss_pred CCEEEEEEcC---CCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 167 AKIIITAGYG---EKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 167 ~~~l~s~~~~---d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
|+++++.|.. .+.|.+||...-....+....+... +... ...+....+..+++|-.|..|++|.+..
T Consensus 776 gr~viv~Gfdk~SeRQv~~Y~Aq~l~~~pl~t~~lDva--ps~L--vP~YD~Ds~~lfltGKGD~~v~~yEv~~ 845 (1012)
T KOG1445|consen 776 GRIVIVVGFDKSSERQVQMYDAQTLDLRPLYTQVLDVA--PSPL--VPHYDYDSNVLFLTGKGDRFVNMYEVIY 845 (1012)
T ss_pred CcEEEEecccccchhhhhhhhhhhccCCcceeeeeccc--Cccc--cccccCCCceEEEecCCCceEEEEEecC
Confidence 9999988762 3678899863222222222222111 1111 1133234456778899999999998754
No 173
>KOG2394 consensus WD40 protein DMR-N9 [General function prediction only]
Probab=99.70 E-value=3.6e-16 Score=132.64 Aligned_cols=136 Identities=15% Similarity=0.182 Sum_probs=114.3
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC--------------Ce--------------eEEEecCCC
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT--------------GE--------------MKWKSTGRH 72 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~--------------~~--------------~~~~~~~~h 72 (340)
...|+|+.|-|.+. ..++++-.+|.+++||... +. .+.++.- -
T Consensus 219 ktsvT~ikWvpg~~--------~~Fl~a~~sGnlyly~~~~~~~~t~p~~~~~k~~~~f~i~t~ksk~~rNPv~~w~~-~ 289 (636)
T KOG2394|consen 219 KSSVTCIKWVPGSD--------SLFLVAHASGNLYLYDKEIVCGATAPSYQALKDGDQFAILTSKSKKTRNPVARWHI-G 289 (636)
T ss_pred ccceEEEEEEeCCC--------ceEEEEEecCceEEeeccccccCCCCcccccCCCCeeEEeeeeccccCCccceeEe-c
Confidence 47899999999873 1677778899999997431 11 1111111 3
Q ss_pred CCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEE
Q 036605 73 PGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLK 150 (340)
Q Consensus 73 ~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~ 150 (340)
.+.|+..+|+|||++|++.+.||.++|||..+.+++..++.--+...|++|+|||+++++++.+ |.||.+...+.+..
T Consensus 290 ~g~in~f~FS~DG~~LA~VSqDGfLRvF~fdt~eLlg~mkSYFGGLLCvcWSPDGKyIvtGGEDDLVtVwSf~erRVVAR 369 (636)
T KOG2394|consen 290 EGSINEFAFSPDGKYLATVSQDGFLRIFDFDTQELLGVMKSYFGGLLCVCWSPDGKYIVTGGEDDLVTVWSFEERRVVAR 369 (636)
T ss_pred cccccceeEcCCCceEEEEecCceEEEeeccHHHHHHHHHhhccceEEEEEcCCccEEEecCCcceEEEEEeccceEEEe
Confidence 4589999999999999999999999999999988888887777889999999999999998888 99999999999999
Q ss_pred eecCCCCeEEEEECC
Q 036605 151 FSDDVGPLQYVSASD 165 (340)
Q Consensus 151 ~~~~~~~v~~~~~s~ 165 (340)
=.+|..+|..++|.|
T Consensus 370 GqGHkSWVs~VaFDp 384 (636)
T KOG2394|consen 370 GQGHKSWVSVVAFDP 384 (636)
T ss_pred ccccccceeeEeecc
Confidence 999999999999987
No 174
>KOG2110 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=99.70 E-value=8.8e-15 Score=118.95 Aligned_cols=185 Identities=14% Similarity=0.097 Sum_probs=142.6
Q ss_pred EEEEEcCC--CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEee---cCCCCe
Q 036605 44 LLALGTSN--GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFK---ASEKPI 118 (340)
Q Consensus 44 ~l~~g~~d--g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~---~~~~~i 118 (340)
++|..+.+ ..+++++++.+..++.+. .+..|.+|.++ .+.|+++=.+ .|++||+.+-+.++++. .+...+
T Consensus 58 LvaiV~~~qpr~Lkv~~~Kk~~~ICe~~--fpt~IL~VrmN--r~RLvV~Lee-~IyIydI~~MklLhTI~t~~~n~~gl 132 (391)
T KOG2110|consen 58 LVAIVSIKQPRKLKVVHFKKKTTICEIF--FPTSILAVRMN--RKRLVVCLEE-SIYIYDIKDMKLLHTIETTPPNPKGL 132 (391)
T ss_pred eeEEEecCCCceEEEEEcccCceEEEEe--cCCceEEEEEc--cceEEEEEcc-cEEEEecccceeehhhhccCCCccce
Confidence 66665544 348999999888888877 56689999997 4566666555 59999999999888764 345567
Q ss_pred eEEEEccCCCEEEE----ecCcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccC
Q 036605 119 SSSAFLCEEKIFAL----ASSEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNK 194 (340)
Q Consensus 119 ~~l~~~~~~~~l~~----~~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~ 194 (340)
.++.+++.+.+++. ..++|.+||+.+-+.+..+..|.+.+.+++|+++|.+|++++...-.|+||.+ ..++...
T Consensus 133 ~AlS~n~~n~ylAyp~s~t~GdV~l~d~~nl~~v~~I~aH~~~lAalafs~~G~llATASeKGTVIRVf~v--~~G~kl~ 210 (391)
T KOG2110|consen 133 CALSPNNANCYLAYPGSTTSGDVVLFDTINLQPVNTINAHKGPLAALAFSPDGTLLATASEKGTVIRVFSV--PEGQKLY 210 (391)
T ss_pred EeeccCCCCceEEecCCCCCceEEEEEcccceeeeEEEecCCceeEEEECCCCCEEEEeccCceEEEEEEc--CCccEee
Confidence 77777777889987 33459999999999999999999999999999999999998885556899999 5665544
Q ss_pred CceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCC
Q 036605 195 GPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVS 239 (340)
Q Consensus 195 ~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~ 239 (340)
.+.-... ...+..+ +| ++++.+|.+.+..++|++|.+....
T Consensus 211 eFRRG~~-~~~IySL--~F-s~ds~~L~~sS~TeTVHiFKL~~~~ 251 (391)
T KOG2110|consen 211 EFRRGTY-PVSIYSL--SF-SPDSQFLAASSNTETVHIFKLEKVS 251 (391)
T ss_pred eeeCCce-eeEEEEE--EE-CCCCCeEEEecCCCeEEEEEecccc
Confidence 3331111 2233334 66 8999999999999999999987633
No 175
>KOG1007 consensus WD repeat protein TSSC1, WD repeat superfamily [Function unknown]
Probab=99.70 E-value=3.4e-15 Score=117.54 Aligned_cols=202 Identities=10% Similarity=0.054 Sum_probs=148.1
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCee-EEEec----CCCCCCeEEEEEec--CCCEEEEEeC
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEM-KWKST----GRHPGGLAGLAFAK--KGRSLHVVGT 93 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~-~~~~~----~~h~~~v~~v~~~~--~~~~l~s~~~ 93 (340)
-+.+.|+.|.|++. -+++-. |..|.+|++..+.. ...+. ..|....++-+|+| +++.+++ ..
T Consensus 123 vg~i~cvew~Pns~---------klasm~-dn~i~l~~l~ess~~vaev~ss~s~e~~~~ftsg~WspHHdgnqv~t-t~ 191 (370)
T KOG1007|consen 123 VGKINCVEWEPNSD---------KLASMD-DNNIVLWSLDESSKIVAEVLSSESAEMRHSFTSGAWSPHHDGNQVAT-TS 191 (370)
T ss_pred hCceeeEEEcCCCC---------eeEEec-cCceEEEEcccCcchheeecccccccccceecccccCCCCccceEEE-eC
Confidence 35899999999986 466554 88999999988764 33332 23566788889998 6677776 56
Q ss_pred CCcEEEEeCCCCeEEEEee-cCCCCeeEEEEccCCCEE-EEecCc--EEEEECCCC-ceeEEeecCCCCeEEEEECCCCC
Q 036605 94 NGMASEMKSEMGEVIREFK-ASEKPISSSAFLCEEKIF-ALASSE--VRILSLENG-EEVLKFSDDVGPLQYVSASDGAK 168 (340)
Q Consensus 94 dg~i~~wd~~~~~~~~~~~-~~~~~i~~l~~~~~~~~l-~~~~~~--i~i~d~~~~-~~~~~~~~~~~~v~~~~~s~~~~ 168 (340)
|+++..||+++......+. +|...+..+.|+|+.+++ ++++.+ |++||.+.. .++..+.+|...|.++.|+|...
T Consensus 192 d~tl~~~D~RT~~~~~sI~dAHgq~vrdlDfNpnkq~~lvt~gDdgyvriWD~R~tk~pv~el~~HsHWvW~VRfn~~hd 271 (370)
T KOG1007|consen 192 DSTLQFWDLRTMKKNNSIEDAHGQRVRDLDFNPNKQHILVTCGDDGYVRIWDTRKTKFPVQELPGHSHWVWAVRFNPEHD 271 (370)
T ss_pred CCcEEEEEccchhhhcchhhhhcceeeeccCCCCceEEEEEcCCCccEEEEeccCCCccccccCCCceEEEEEEecCccc
Confidence 8899999999876655543 577789999999997765 555554 999999864 46688899999999999998754
Q ss_pred -EEEEEEcCCCeEEEEEccCCCCCcc-------------------C-----CceeeecCCCeeeeeecCCCCCCCCEEEE
Q 036605 169 -IIITAGYGEKHLQVWRCDISSKTVN-------------------K-----GPALSMRHSPVAIDCKNSPNGEDGTVILA 223 (340)
Q Consensus 169 -~l~s~~~~d~~i~iwd~~~~~~~~~-------------------~-----~~~~~~~~~~~~~~~~~~~~~~~~~~l~~ 223 (340)
.|+++++ |..|.+|-....+.+.. . .+...-.|...+..+ .|.+.+.-.+++
T Consensus 272 qLiLs~~S-Ds~V~Lsca~svSSE~qi~~~~dese~e~~dseer~kpL~dg~l~tydehEDSVY~~--aWSsadPWiFAS 348 (370)
T KOG1007|consen 272 QLILSGGS-DSAVNLSCASSVSSEQQIEFEDDESESEDEDSEERVKPLQDGQLETYDEHEDSVYAL--AWSSADPWIFAS 348 (370)
T ss_pred eEEEecCC-CceeEEEeccccccccccccccccccCcchhhHHhcccccccccccccccccceEEE--eeccCCCeeEEE
Confidence 5566555 99999997632211100 0 111122577778777 887888889999
Q ss_pred EeCCCcEEEEECC
Q 036605 224 VAESGVAYSWDLK 236 (340)
Q Consensus 224 ~s~dg~i~vwd~~ 236 (340)
-+.||++.|=.+.
T Consensus 349 LSYDGRviIs~V~ 361 (370)
T KOG1007|consen 349 LSYDGRVIISSVP 361 (370)
T ss_pred eccCceEEeecCC
Confidence 9999999887654
No 176
>KOG0771 consensus Prolactin regulatory element-binding protein/Protein transport protein SEC12p [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.69 E-value=4.6e-16 Score=128.36 Aligned_cols=194 Identities=15% Similarity=0.177 Sum_probs=141.6
Q ss_pred EEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCC
Q 036605 25 SCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEM 104 (340)
Q Consensus 25 ~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~ 104 (340)
.+++|+++|. .|++|+.||+++||+......+..... |.+.|.++.|+|||+.|++.+.| ..+||+.++
T Consensus 148 k~vaf~~~gs---------~latgg~dg~lRv~~~Ps~~t~l~e~~-~~~eV~DL~FS~dgk~lasig~d-~~~VW~~~~ 216 (398)
T KOG0771|consen 148 KVVAFNGDGS---------KLATGGTDGTLRVWEWPSMLTILEEIA-HHAEVKDLDFSPDGKFLASIGAD-SARVWSVNT 216 (398)
T ss_pred eEEEEcCCCC---------EeeeccccceEEEEecCcchhhhhhHh-hcCccccceeCCCCcEEEEecCC-ceEEEEecc
Confidence 7899999998 899999999999999877766656666 88999999999999999999999 999999999
Q ss_pred CeEEEEeec--CCCCeeEEEEccCC---CEE-EE-e--cCcEEEEECCCCc-----eeEEeecCCCCeEEEEECCCCCEE
Q 036605 105 GEVIREFKA--SEKPISSSAFLCEE---KIF-AL-A--SSEVRILSLENGE-----EVLKFSDDVGPLQYVSASDGAKII 170 (340)
Q Consensus 105 ~~~~~~~~~--~~~~i~~l~~~~~~---~~l-~~-~--~~~i~i~d~~~~~-----~~~~~~~~~~~v~~~~~s~~~~~l 170 (340)
|..+..... .......+.|+.|+ .+. ++ . .+.|..||+.... ..++.......|++++.+++|+++
T Consensus 217 g~~~a~~t~~~k~~~~~~cRF~~d~~~~~l~laa~~~~~~~v~~~~~~~w~~~~~l~~~~~~~~~~siSsl~VS~dGkf~ 296 (398)
T KOG0771|consen 217 GAALARKTPFSKDEMFSSCRFSVDNAQETLRLAASQFPGGGVRLCDISLWSGSNFLRLRKKIKRFKSISSLAVSDDGKFL 296 (398)
T ss_pred CchhhhcCCcccchhhhhceecccCCCceEEEEEecCCCCceeEEEeeeeccccccchhhhhhccCcceeEEEcCCCcEE
Confidence 966655442 22235566777665 222 22 1 1115555543221 112222334579999999999999
Q ss_pred EEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 171 ITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 171 ~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
+.++. ||.|.|++. .+-+ ........|...+..+ .| +|+..++++.+.|..+.|..+..
T Consensus 297 AlGT~-dGsVai~~~--~~lq--~~~~vk~aH~~~VT~l--tF-~Pdsr~~~svSs~~~~~v~~l~v 355 (398)
T KOG0771|consen 297 ALGTM-DGSVAIYDA--KSLQ--RLQYVKEAHLGFVTGL--TF-SPDSRYLASVSSDNEAAVTKLAV 355 (398)
T ss_pred EEecc-CCcEEEEEe--ceee--eeEeehhhheeeeeeE--EE-cCCcCcccccccCCceeEEEEee
Confidence 99877 999999997 2322 2222233566666666 66 89999999999999999988765
No 177
>PRK01742 tolB translocation protein TolB; Provisional
Probab=99.69 E-value=4.6e-15 Score=132.08 Aligned_cols=203 Identities=12% Similarity=0.120 Sum_probs=130.7
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCC---CcEEEEEccCCeeEEEecCCCCCCeE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSN---GDILAVDVLTGEMKWKSTGRHPGGLA 77 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~d---g~i~i~d~~~~~~~~~~~~~h~~~v~ 77 (340)
|||...+. ...+. .+...+...+|||||+ .|+..+.+ ..|++||+.+++... +.. ..+...
T Consensus 188 i~d~dg~~-~~~lt----~~~~~v~~p~wSPDG~---------~la~~s~~~~~~~i~i~dl~tg~~~~-l~~-~~g~~~ 251 (429)
T PRK01742 188 VADYDGFN-QFIVN----RSSQPLMSPAWSPDGS---------KLAYVSFENKKSQLVVHDLRSGARKV-VAS-FRGHNG 251 (429)
T ss_pred EECCCCCC-ceEec----cCCCccccceEcCCCC---------EEEEEEecCCCcEEEEEeCCCCceEE-Eec-CCCccC
Confidence 35554333 33444 4667899999999998 77776543 469999998876322 222 223345
Q ss_pred EEEEecCCCEEEEEe-CCCcEE--EEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEe-c--CcEEEEEC--CCCceeE
Q 036605 78 GLAFAKKGRSLHVVG-TNGMAS--EMKSEMGEVIREFKASEKPISSSAFLCEEKIFALA-S--SEVRILSL--ENGEEVL 149 (340)
Q Consensus 78 ~v~~~~~~~~l~s~~-~dg~i~--~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~-~--~~i~i~d~--~~~~~~~ 149 (340)
.++|+|||+.|+.++ .+|.+. +||+.++.. ..+..+...+..+.|+|||+.++.. + +...||++ ..+.. .
T Consensus 252 ~~~wSPDG~~La~~~~~~g~~~Iy~~d~~~~~~-~~lt~~~~~~~~~~wSpDG~~i~f~s~~~g~~~I~~~~~~~~~~-~ 329 (429)
T PRK01742 252 APAFSPDGSRLAFASSKDGVLNIYVMGANGGTP-SQLTSGAGNNTEPSWSPDGQSILFTSDRSGSPQVYRMSASGGGA-S 329 (429)
T ss_pred ceeECCCCCEEEEEEecCCcEEEEEEECCCCCe-EeeccCCCCcCCEEECCCCCEEEEEECCCCCceEEEEECCCCCe-E
Confidence 789999999888764 577654 557766654 4555566678899999999987653 2 33555554 33322 2
Q ss_pred EeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCc
Q 036605 150 KFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGV 229 (340)
Q Consensus 150 ~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~ 229 (340)
.+ .+.. ....|+|+|++|+..+. ++ +.+||+ .++.... +. ...... ...| +|+|.+|+.++.+|.
T Consensus 330 ~l-~~~~--~~~~~SpDG~~ia~~~~-~~-i~~~Dl--~~g~~~~-lt--~~~~~~----~~~~-sPdG~~i~~~s~~g~ 394 (429)
T PRK01742 330 LV-GGRG--YSAQISADGKTLVMING-DN-VVKQDL--TSGSTEV-LS--STFLDE----SPSI-SPNGIMIIYSSTQGL 394 (429)
T ss_pred Ee-cCCC--CCccCCCCCCEEEEEcC-CC-EEEEEC--CCCCeEE-ec--CCCCCC----CceE-CCCCCEEEEEEcCCC
Confidence 22 3333 45789999999988665 54 556887 3433211 11 011111 1244 899999999999998
Q ss_pred EEEEECC
Q 036605 230 AYSWDLK 236 (340)
Q Consensus 230 i~vwd~~ 236 (340)
+.+|.+.
T Consensus 395 ~~~l~~~ 401 (429)
T PRK01742 395 GKVLQLV 401 (429)
T ss_pred ceEEEEE
Confidence 8888764
No 178
>COG2319 FOG: WD40 repeat [General function prediction only]
Probab=99.68 E-value=7.1e-14 Score=124.13 Aligned_cols=217 Identities=22% Similarity=0.366 Sum_probs=162.6
Q ss_pred CccCCC-CceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcC-CCcEEEEEccCCeeEEEecCCCCCCeEE
Q 036605 1 IWSTND-GSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTS-NGDILAVDVLTGEMKWKSTGRHPGGLAG 78 (340)
Q Consensus 1 vwd~~~-g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~-dg~i~i~d~~~~~~~~~~~~~h~~~v~~ 78 (340)
+||... +.....+. .|...|.+++|+|+++ ++++++. ++.+.+|++..+.....+.+ |...|.+
T Consensus 138 ~~~~~~~~~~~~~~~----~~~~~v~~~~~~~~~~---------~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~v~~ 203 (466)
T COG2319 138 LWDLSTPGKLIRTLE----GHSESVTSLAFSPDGK---------LLASGSSLDGTIKLWDLRTGKPLSTLAG-HTDPVSS 203 (466)
T ss_pred EEEecCCCeEEEEEe----cCcccEEEEEECCCCC---------EEEecCCCCCceEEEEcCCCceEEeecc-CCCceEE
Confidence 366665 55555665 7889999999999998 7888885 99999999998888888888 9999999
Q ss_pred EEEecCCC-EEEEEeCCCcEEEEeCCCCeEEE-EeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCce-eEEeec
Q 036605 79 LAFAKKGR-SLHVVGTNGMASEMKSEMGEVIR-EFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEE-VLKFSD 153 (340)
Q Consensus 79 v~~~~~~~-~l~s~~~dg~i~~wd~~~~~~~~-~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~-~~~~~~ 153 (340)
++|+|++. .+++++.|+.|.+||...+.... .+..|.... ...|+|++..+++++.+ +++|++..... +..+..
T Consensus 204 ~~~~~~~~~~~~~~~~d~~i~~wd~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~d~~~~~~~~~~~~~~~~~~~~ 282 (466)
T COG2319 204 LAFSPDGGLLIASGSSDGTIRLWDLSTGKLLRSTLSGHSDSV-VSSFSPDGSLLASGSSDGTIRLWDLRSSSSLLRTLSG 282 (466)
T ss_pred EEEcCCcceEEEEecCCCcEEEEECCCCcEEeeecCCCCcce-eEeECCCCCEEEEecCCCcEEEeeecCCCcEEEEEec
Confidence 99999998 55555899999999998888777 577777664 34899999777664444 99999987665 444467
Q ss_pred CCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEE-eCCCcEEE
Q 036605 154 DVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAV-AESGVAYS 232 (340)
Q Consensus 154 ~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~-s~dg~i~v 232 (340)
|...+.++.|.|++..+++++. |+.+.+|++. ......... ...|...+..+ .+ .+++..++.+ ..|+.+.+
T Consensus 283 ~~~~v~~~~~~~~~~~~~~~~~-d~~~~~~~~~--~~~~~~~~~-~~~~~~~~~~~--~~-~~~~~~~~~~~~~d~~~~~ 355 (466)
T COG2319 283 HSSSVLSVAFSPDGKLLASGSS-DGTVRLWDLE--TGKLLSSLT-LKGHEGPVSSL--SF-SPDGSLLVSGGSDDGTIRL 355 (466)
T ss_pred CCccEEEEEECCCCCEEEEeeC-CCcEEEEEcC--CCceEEEee-ecccCCceEEE--EE-CCCCCEEEEeecCCCcEEe
Confidence 8899999999998889998666 7889999873 322211111 12344334444 22 2344555555 68899999
Q ss_pred EECCCCC
Q 036605 233 WDLKTVS 239 (340)
Q Consensus 233 wd~~~~~ 239 (340)
|++....
T Consensus 356 ~~~~~~~ 362 (466)
T COG2319 356 WDLRTGK 362 (466)
T ss_pred eecCCCc
Confidence 9988765
No 179
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=99.67 E-value=6.7e-14 Score=120.79 Aligned_cols=197 Identities=10% Similarity=0.063 Sum_probs=130.5
Q ss_pred CeEEEEeeccccccccccCceEEEEEc-CCCcEEEEEccC-Ce---eEEEecCCCCCCeEEEEEecCCCEEEEEe-CCCc
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGT-SNGDILAVDVLT-GE---MKWKSTGRHPGGLAGLAFAKKGRSLHVVG-TNGM 96 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~-~dg~i~i~d~~~-~~---~~~~~~~~h~~~v~~v~~~~~~~~l~s~~-~dg~ 96 (340)
....++|+|+++ +|++++ .++.|.+|++.+ +. ....+. +.....+++++|+++++++++ .++.
T Consensus 81 ~p~~i~~~~~g~---------~l~v~~~~~~~v~v~~~~~~g~~~~~~~~~~--~~~~~~~~~~~p~g~~l~v~~~~~~~ 149 (330)
T PRK11028 81 SPTHISTDHQGR---------FLFSASYNANCVSVSPLDKDGIPVAPIQIIE--GLEGCHSANIDPDNRTLWVPCLKEDR 149 (330)
T ss_pred CceEEEECCCCC---------EEEEEEcCCCeEEEEEECCCCCCCCceeecc--CCCcccEeEeCCCCCEEEEeeCCCCE
Confidence 456899999998 677665 488999999964 32 222222 333567789999999987665 4589
Q ss_pred EEEEeCCCCeEEE-------EeecCCCCeeEEEEccCCCEEEEe---cCcEEEEECCC--Cc--eeEEeecCC------C
Q 036605 97 ASEMKSEMGEVIR-------EFKASEKPISSSAFLCEEKIFALA---SSEVRILSLEN--GE--EVLKFSDDV------G 156 (340)
Q Consensus 97 i~~wd~~~~~~~~-------~~~~~~~~i~~l~~~~~~~~l~~~---~~~i~i~d~~~--~~--~~~~~~~~~------~ 156 (340)
|.+||+.+...+. ... .......++|+|++++++++ ++.|.+|++.. ++ .+..+..++ .
T Consensus 150 v~v~d~~~~g~l~~~~~~~~~~~-~g~~p~~~~~~pdg~~lyv~~~~~~~v~v~~~~~~~~~~~~~~~~~~~p~~~~~~~ 228 (330)
T PRK11028 150 IRLFTLSDDGHLVAQEPAEVTTV-EGAGPRHMVFHPNQQYAYCVNELNSSVDVWQLKDPHGEIECVQTLDMMPADFSDTR 228 (330)
T ss_pred EEEEEECCCCcccccCCCceecC-CCCCCceEEECCCCCEEEEEecCCCEEEEEEEeCCCCCEEEEEEEecCCCcCCCCc
Confidence 9999997633221 111 12345789999999999774 44599999873 32 233332221 2
Q ss_pred CeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeC-CCcEEEEEC
Q 036605 157 PLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAE-SGVAYSWDL 235 (340)
Q Consensus 157 ~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~-dg~i~vwd~ 235 (340)
....+.|+|++++++++...++.|.+|+++.........-....+..+..+.+ +++|.+|+++.. ++.|.+|++
T Consensus 229 ~~~~i~~~pdg~~lyv~~~~~~~I~v~~i~~~~~~~~~~~~~~~~~~p~~~~~-----~~dg~~l~va~~~~~~v~v~~~ 303 (330)
T PRK11028 229 WAADIHITPDGRHLYACDRTASLISVFSVSEDGSVLSFEGHQPTETQPRGFNI-----DHSGKYLIAAGQKSHHISVYEI 303 (330)
T ss_pred cceeEEECCCCCEEEEecCCCCeEEEEEEeCCCCeEEEeEEEeccccCCceEE-----CCCCCEEEEEEccCCcEEEEEE
Confidence 23468899999999998766899999999532221111111111223333444 899999998776 889999987
Q ss_pred C
Q 036605 236 K 236 (340)
Q Consensus 236 ~ 236 (340)
.
T Consensus 304 ~ 304 (330)
T PRK11028 304 D 304 (330)
T ss_pred c
Confidence 5
No 180
>PRK05137 tolB translocation protein TolB; Provisional
Probab=99.67 E-value=6.9e-14 Score=124.95 Aligned_cols=197 Identities=13% Similarity=0.113 Sum_probs=133.7
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcC---CCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEE-EEeCC
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTS---NGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLH-VVGTN 94 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~---dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~-s~~~d 94 (340)
.+...+.+.+|+|||+ .|+..+. +..|++||+.+++.. .+.. +.+.+...+|+|||+.|+ +.+.+
T Consensus 199 ~~~~~v~~p~wSpDG~---------~lay~s~~~g~~~i~~~dl~~g~~~-~l~~-~~g~~~~~~~SPDG~~la~~~~~~ 267 (435)
T PRK05137 199 DGSSLVLTPRFSPNRQ---------EITYMSYANGRPRVYLLDLETGQRE-LVGN-FPGMTFAPRFSPDGRKVVMSLSQG 267 (435)
T ss_pred cCCCCeEeeEECCCCC---------EEEEEEecCCCCEEEEEECCCCcEE-Eeec-CCCcccCcEECCCCCEEEEEEecC
Confidence 5667899999999998 6776553 468999999888643 4554 667788999999999775 45555
Q ss_pred C--cEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec-C----cEEEEECCCCceeEEeecCCCCeEEEEECCCC
Q 036605 95 G--MASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALAS-S----EVRILSLENGEEVLKFSDDVGPLQYVSASDGA 167 (340)
Q Consensus 95 g--~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~-~----~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~ 167 (340)
+ .|.+||+.++.. ..+..+........|+|||+.++..+ + +|+++|+.++.. ..+..+...+....|+|+|
T Consensus 268 g~~~Iy~~d~~~~~~-~~Lt~~~~~~~~~~~spDG~~i~f~s~~~g~~~Iy~~d~~g~~~-~~lt~~~~~~~~~~~SpdG 345 (435)
T PRK05137 268 GNTDIYTMDLRSGTT-TRLTDSPAIDTSPSYSPDGSQIVFESDRSGSPQLYVMNADGSNP-RRISFGGGRYSTPVWSPRG 345 (435)
T ss_pred CCceEEEEECCCCce-EEccCCCCccCceeEcCCCCEEEEEECCCCCCeEEEEECCCCCe-EEeecCCCcccCeEECCCC
Confidence 5 488889988765 44555555667889999999886633 2 399999877643 4454445556778999999
Q ss_pred CEEEEEEcCCC--eEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCC------CcEEEEECCCC
Q 036605 168 KIIITAGYGEK--HLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAES------GVAYSWDLKTV 238 (340)
Q Consensus 168 ~~l~s~~~~d~--~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~d------g~i~vwd~~~~ 238 (340)
++|+......+ .|.+||+ ..+.. ..+. ... .... ..| +|||..|+..+.+ ..++++++...
T Consensus 346 ~~ia~~~~~~~~~~i~~~d~--~~~~~-~~lt--~~~--~~~~--p~~-spDG~~i~~~~~~~~~~~~~~L~~~dl~g~ 414 (435)
T PRK05137 346 DLIAFTKQGGGQFSIGVMKP--DGSGE-RILT--SGF--LVEG--PTW-APNGRVIMFFRQTPGSGGAPKLYTVDLTGR 414 (435)
T ss_pred CEEEEEEcCCCceEEEEEEC--CCCce-Eecc--CCC--CCCC--CeE-CCCCCEEEEEEccCCCCCcceEEEEECCCC
Confidence 99988665333 5677776 33221 1111 111 1111 244 8999988776543 25777777553
No 181
>KOG0303 consensus Actin-binding protein Coronin, contains WD40 repeats [Cytoskeleton]
Probab=99.67 E-value=4.1e-15 Score=121.81 Aligned_cols=155 Identities=17% Similarity=0.208 Sum_probs=129.5
Q ss_pred CCCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcE
Q 036605 19 EPVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMA 97 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i 97 (340)
+|...|--++|+|.. . .|++++.|.+|.+||+.+|+.+..+. |++.|++++|+.||.+|++.+.|..|
T Consensus 129 gH~rrVg~V~wHPtA~N---------VLlsag~Dn~v~iWnv~tgeali~l~--hpd~i~S~sfn~dGs~l~TtckDKkv 197 (472)
T KOG0303|consen 129 GHQRRVGLVQWHPTAPN---------VLLSAGSDNTVSIWNVGTGEALITLD--HPDMVYSMSFNRDGSLLCTTCKDKKV 197 (472)
T ss_pred ecceeEEEEeecccchh---------hHhhccCCceEEEEeccCCceeeecC--CCCeEEEEEeccCCceeeeeccccee
Confidence 899999999999987 5 89999999999999999999887777 99999999999999999999999999
Q ss_pred EEEeCCCCeEEEEeecCCC-CeeEEEEccCCCEEEEe-----cCcEEEEECCCCcee---EEeecCCCCeEEEEECCCCC
Q 036605 98 SEMKSEMGEVIREFKASEK-PISSSAFLCEEKIFALA-----SSEVRILSLENGEEV---LKFSDDVGPLQYVSASDGAK 168 (340)
Q Consensus 98 ~~wd~~~~~~~~~~~~~~~-~i~~l~~~~~~~~l~~~-----~~~i~i~d~~~~~~~---~~~~~~~~~v~~~~~s~~~~ 168 (340)
++||.++++.+..-.+|.+ ....+.|-.++.++.++ .+++-+||....+.. ..+. ..+.|.---|.+|..
T Consensus 198 Rv~dpr~~~~v~e~~~heG~k~~Raifl~~g~i~tTGfsr~seRq~aLwdp~nl~eP~~~~elD-tSnGvl~PFyD~dt~ 276 (472)
T KOG0303|consen 198 RVIDPRRGTVVSEGVAHEGAKPARAIFLASGKIFTTGFSRMSERQIALWDPNNLEEPIALQELD-TSNGVLLPFYDPDTS 276 (472)
T ss_pred EEEcCCCCcEeeecccccCCCcceeEEeccCceeeeccccccccceeccCcccccCcceeEEec-cCCceEEeeecCCCC
Confidence 9999999999988777765 34556677888855442 334999997654433 3333 345677777899999
Q ss_pred EEEEEEcCCCeEEEEEc
Q 036605 169 IIITAGYGEKHLQVWRC 185 (340)
Q Consensus 169 ~l~s~~~~d~~i~iwd~ 185 (340)
.++.+|.+|+.|+.|.+
T Consensus 277 ivYl~GKGD~~IRYyEi 293 (472)
T KOG0303|consen 277 IVYLCGKGDSSIRYFEI 293 (472)
T ss_pred EEEEEecCCcceEEEEe
Confidence 99999999999999998
No 182
>KOG0290 consensus Conserved WD40 repeat-containing protein AN11 [Function unknown]
Probab=99.66 E-value=9.6e-15 Score=115.17 Aligned_cols=159 Identities=18% Similarity=0.213 Sum_probs=125.5
Q ss_pred CCCCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCe---eEEEecCCCCCCeEEEEEecCCC-EEEEEe
Q 036605 18 GEPVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGE---MKWKSTGRHPGGLAGLAFAKKGR-SLHVVG 92 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~---~~~~~~~~h~~~v~~v~~~~~~~-~l~s~~ 92 (340)
+++..++++..|..-. + ++.+.+-|-+..|||++++. ....+.. |...|..++|...+. .++++|
T Consensus 147 s~~~aPlTSFDWne~dp~---------~igtSSiDTTCTiWdie~~~~~~vkTQLIA-HDKEV~DIaf~~~s~~~FASvg 216 (364)
T KOG0290|consen 147 SEFCAPLTSFDWNEVDPN---------LIGTSSIDTTCTIWDIETGVSGTVKTQLIA-HDKEVYDIAFLKGSRDVFASVG 216 (364)
T ss_pred cccCCcccccccccCCcc---------eeEeecccCeEEEEEEeeccccceeeEEEe-cCcceeEEEeccCccceEEEec
Confidence 3667889999998665 6 89999999999999999873 3455666 999999999998554 788999
Q ss_pred CCCcEEEEeCCCCeEEEEeecC---CCCeeEEEEccCC-CEEEE---ecCcEEEEECCCC-ceeEEeecCCCCeEEEEEC
Q 036605 93 TNGMASEMKSEMGEVIREFKAS---EKPISSSAFLCEE-KIFAL---ASSEVRILSLENG-EEVLKFSDDVGPLQYVSAS 164 (340)
Q Consensus 93 ~dg~i~~wd~~~~~~~~~~~~~---~~~i~~l~~~~~~-~~l~~---~~~~i~i~d~~~~-~~~~~~~~~~~~v~~~~~s 164 (340)
.||.|++||++..+.-..+... ..+...++|++.. +++|+ .+..|.|.|++.. .++..+.+|.+.|+.++|.
T Consensus 217 aDGSvRmFDLR~leHSTIIYE~p~~~~pLlRLswnkqDpnymATf~~dS~~V~iLDiR~P~tpva~L~~H~a~VNgIaWa 296 (364)
T KOG0290|consen 217 ADGSVRMFDLRSLEHSTIIYEDPSPSTPLLRLSWNKQDPNYMATFAMDSNKVVILDIRVPCTPVARLRNHQASVNGIAWA 296 (364)
T ss_pred CCCcEEEEEecccccceEEecCCCCCCcceeeccCcCCchHHhhhhcCCceEEEEEecCCCcceehhhcCcccccceEec
Confidence 9999999999987654443322 4567788898765 45555 3444999999875 4568899999999999999
Q ss_pred CCCC-EEEEEEcCCCeEEEEEccC
Q 036605 165 DGAK-IIITAGYGEKHLQVWRCDI 187 (340)
Q Consensus 165 ~~~~-~l~s~~~~d~~i~iwd~~~ 187 (340)
|... .|.++|. |..+.|||+..
T Consensus 297 PhS~~hictaGD-D~qaliWDl~q 319 (364)
T KOG0290|consen 297 PHSSSHICTAGD-DCQALIWDLQQ 319 (364)
T ss_pred CCCCceeeecCC-cceEEEEeccc
Confidence 8754 5666666 99999999953
No 183
>KOG0290 consensus Conserved WD40 repeat-containing protein AN11 [Function unknown]
Probab=99.66 E-value=1.6e-14 Score=113.97 Aligned_cols=211 Identities=15% Similarity=0.096 Sum_probs=152.8
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC--CeeE--EEe----cCCCCCCeEEEEEec-CCCEE
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT--GEMK--WKS----TGRHPGGLAGLAFAK-KGRSL 88 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~--~~~~--~~~----~~~h~~~v~~v~~~~-~~~~l 88 (340)
..|..+++.+.|.|+..... .++||+. +..+++|.+.. .+.. ..+ ...+.+++++..|+. +-+++
T Consensus 93 fd~~YP~tK~~wiPd~~g~~----pdlLATs--~D~LRlWri~~ee~~~~~~~~L~~~kns~~~aPlTSFDWne~dp~~i 166 (364)
T KOG0290|consen 93 FDHPYPVTKLMWIPDSKGVY----PDLLATS--SDFLRLWRIGDEESRVELQSVLNNNKNSEFCAPLTSFDWNEVDPNLI 166 (364)
T ss_pred CCCCCCccceEecCCccccC----cchhhcc--cCeEEEEeccCcCCceehhhhhccCcccccCCcccccccccCCccee
Confidence 46889999999999874111 1256554 44699998773 2211 111 113678999999986 66789
Q ss_pred EEEeCCCcEEEEeCCCCe---EEEEeecCCCCeeEEEEccCCCEE-EE--ecCcEEEEECCCCceeEEe---ecCCCCeE
Q 036605 89 HVVGTNGMASEMKSEMGE---VIREFKASEKPISSSAFLCEEKIF-AL--ASSEVRILSLENGEEVLKF---SDDVGPLQ 159 (340)
Q Consensus 89 ~s~~~dg~i~~wd~~~~~---~~~~~~~~~~~i~~l~~~~~~~~l-~~--~~~~i~i~d~~~~~~~~~~---~~~~~~v~ 159 (340)
.+++-|.++.+||++++. +...+-+|...|+.++|...+.-+ ++ ++|.+++||++..+.-..+ .....+..
T Consensus 167 gtSSiDTTCTiWdie~~~~~~vkTQLIAHDKEV~DIaf~~~s~~~FASvgaDGSvRmFDLR~leHSTIIYE~p~~~~pLl 246 (364)
T KOG0290|consen 167 GTSSIDTTCTIWDIETGVSGTVKTQLIAHDKEVYDIAFLKGSRDVFASVGADGSVRMFDLRSLEHSTIIYEDPSPSTPLL 246 (364)
T ss_pred EeecccCeEEEEEEeeccccceeeEEEecCcceeEEEeccCccceEEEecCCCcEEEEEecccccceEEecCCCCCCcce
Confidence 999999999999999873 356688999999999999977544 44 6677999999876543222 22246777
Q ss_pred EEEECCCC-CEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 160 YVSASDGA-KIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 160 ~~~~s~~~-~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
.++|++.. +|+++-+.+...|.|-|+|.. ......+. .|...+..+ .|.......+++++.|..+.+||+...
T Consensus 247 RLswnkqDpnymATf~~dS~~V~iLDiR~P-~tpva~L~---~H~a~VNgI--aWaPhS~~hictaGDD~qaliWDl~q~ 320 (364)
T KOG0290|consen 247 RLSWNKQDPNYMATFAMDSNKVVILDIRVP-CTPVARLR---NHQASVNGI--AWAPHSSSHICTAGDDCQALIWDLQQM 320 (364)
T ss_pred eeccCcCCchHHhhhhcCCceEEEEEecCC-Ccceehhh---cCcccccce--EecCCCCceeeecCCcceEEEEecccc
Confidence 88887654 566666665678999999743 33334444 788888877 775566788999999999999999875
Q ss_pred Cc
Q 036605 239 SQ 240 (340)
Q Consensus 239 ~~ 240 (340)
-.
T Consensus 321 ~~ 322 (364)
T KOG0290|consen 321 PR 322 (364)
T ss_pred cc
Confidence 44
No 184
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=99.66 E-value=6.8e-14 Score=120.74 Aligned_cols=202 Identities=12% Similarity=0.143 Sum_probs=132.3
Q ss_pred CCeEEEEeeccccccccccCceEEEEE-cCCCcEEEEEcc-CCee--EEEecCCCCCCeEEEEEecCCCEEEEEeC-CCc
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALG-TSNGDILAVDVL-TGEM--KWKSTGRHPGGLAGLAFAKKGRSLHVVGT-NGM 96 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g-~~dg~i~i~d~~-~~~~--~~~~~~~h~~~v~~v~~~~~~~~l~s~~~-dg~ 96 (340)
.....++++|+++ +|+++ ..++.|.+|++. ++.. ..... ..+....++|+|+++.|++++. ++.
T Consensus 35 ~~~~~l~~spd~~---------~lyv~~~~~~~i~~~~~~~~g~l~~~~~~~--~~~~p~~i~~~~~g~~l~v~~~~~~~ 103 (330)
T PRK11028 35 GQVQPMVISPDKR---------HLYVGVRPEFRVLSYRIADDGALTFAAESP--LPGSPTHISTDHQGRFLFSASYNANC 103 (330)
T ss_pred CCCccEEECCCCC---------EEEEEECCCCcEEEEEECCCCceEEeeeec--CCCCceEEEECCCCCEEEEEEcCCCe
Confidence 5567899999998 77665 458899999986 3432 22222 3345678999999999998874 789
Q ss_pred EEEEeCCC-Ce---EEEEeecCCCCeeEEEEccCCCEEEEe---cCcEEEEECCCCceeEE-----ee-cCCCCeEEEEE
Q 036605 97 ASEMKSEM-GE---VIREFKASEKPISSSAFLCEEKIFALA---SSEVRILSLENGEEVLK-----FS-DDVGPLQYVSA 163 (340)
Q Consensus 97 i~~wd~~~-~~---~~~~~~~~~~~i~~l~~~~~~~~l~~~---~~~i~i~d~~~~~~~~~-----~~-~~~~~v~~~~~ 163 (340)
|.+|++.+ +. .+..+. +.....+++++|++++++++ ++.|.+||+.+...+.. .. ........+.|
T Consensus 104 v~v~~~~~~g~~~~~~~~~~-~~~~~~~~~~~p~g~~l~v~~~~~~~v~v~d~~~~g~l~~~~~~~~~~~~g~~p~~~~~ 182 (330)
T PRK11028 104 VSVSPLDKDGIPVAPIQIIE-GLEGCHSANIDPDNRTLWVPCLKEDRIRLFTLSDDGHLVAQEPAEVTTVEGAGPRHMVF 182 (330)
T ss_pred EEEEEECCCCCCCCceeecc-CCCcccEeEeCCCCCEEEEeeCCCCEEEEEEECCCCcccccCCCceecCCCCCCceEEE
Confidence 99999864 22 222222 22346788999999998663 34499999976432211 11 11234578999
Q ss_pred CCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeee-----cCCCeeeeeecCCCCCCCCEEEEEeC-CCcEEEEECCC
Q 036605 164 SDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSM-----RHSPVAIDCKNSPNGEDGTVILAVAE-SGVAYSWDLKT 237 (340)
Q Consensus 164 s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~-----~~~~~~~~~~~~~~~~~~~~l~~~s~-dg~i~vwd~~~ 237 (340)
+|++++++++...++.|.+|+++..++.......+.. ..+.....+ .+ +|++.+++++.. ++.|.+|++..
T Consensus 183 ~pdg~~lyv~~~~~~~v~v~~~~~~~~~~~~~~~~~~~p~~~~~~~~~~~i--~~-~pdg~~lyv~~~~~~~I~v~~i~~ 259 (330)
T PRK11028 183 HPNQQYAYCVNELNSSVDVWQLKDPHGEIECVQTLDMMPADFSDTRWAADI--HI-TPDGRHLYACDRTASLISVFSVSE 259 (330)
T ss_pred CCCCCEEEEEecCCCEEEEEEEeCCCCCEEEEEEEecCCCcCCCCccceeE--EE-CCCCCEEEEecCCCCeEEEEEEeC
Confidence 9999999998777999999999522222111111100 011111111 23 799999988854 68899999865
Q ss_pred C
Q 036605 238 V 238 (340)
Q Consensus 238 ~ 238 (340)
.
T Consensus 260 ~ 260 (330)
T PRK11028 260 D 260 (330)
T ss_pred C
Confidence 3
No 185
>KOG1009 consensus Chromatin assembly complex 1 subunit B/CAC2 (contains WD40 repeats) [Chromatin structure and dynamics; Replication, recombination and repair]
Probab=99.66 E-value=3.4e-14 Score=116.87 Aligned_cols=110 Identities=15% Similarity=0.140 Sum_probs=92.0
Q ss_pred eeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEcc--------C-----C---eeEEEecCCCCCCe
Q 036605 13 WKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVL--------T-----G---EMKWKSTGRHPGGL 76 (340)
Q Consensus 13 ~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~--------~-----~---~~~~~~~~~h~~~v 76 (340)
|....++|...|+++.|+|+|. +||+|+.+|.|.+|-.. + . .....+.+ |...|
T Consensus 57 y~s~Ls~H~~aVN~vRf~p~ge---------lLASg~D~g~v~lWk~~~~~~~~~d~e~~~~ke~w~v~k~lr~-h~~di 126 (434)
T KOG1009|consen 57 YLSSLSRHTRAVNVVRFSPDGE---------LLASGGDGGEVFLWKQGDVRIFDADTEADLNKEKWVVKKVLRG-HRDDI 126 (434)
T ss_pred EeecccCCcceeEEEEEcCCcC---------eeeecCCCceEEEEEecCcCCccccchhhhCccceEEEEEecc-cccch
Confidence 3333359999999999999999 99999999999999765 2 1 12334455 99999
Q ss_pred EEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE
Q 036605 77 AGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL 132 (340)
Q Consensus 77 ~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~ 132 (340)
..++|+|++..+++++-|..+++||+..|.....+..|...+..++|.|-++++++
T Consensus 127 ydL~Ws~d~~~l~s~s~dns~~l~Dv~~G~l~~~~~dh~~yvqgvawDpl~qyv~s 182 (434)
T KOG1009|consen 127 YDLAWSPDSNFLVSGSVDNSVRLWDVHAGQLLAILDDHEHYVQGVAWDPLNQYVAS 182 (434)
T ss_pred hhhhccCCCceeeeeeccceEEEEEeccceeEeeccccccccceeecchhhhhhhh
Confidence 99999999999999999999999999999988888888888888888877776655
No 186
>PF08662 eIF2A: Eukaryotic translation initiation factor eIF2A; InterPro: IPR013979 This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins.
Probab=99.65 E-value=3.3e-14 Score=111.96 Aligned_cols=147 Identities=14% Similarity=0.225 Sum_probs=107.1
Q ss_pred EEEEeeccccccccccCceEEEEEcC----------CCcEEEEEccCC-eeEEEecCCCCCCeEEEEEecCCCEEEEE--
Q 036605 25 SCLACGFVGKKRRKERGTLLLALGTS----------NGDILAVDVLTG-EMKWKSTGRHPGGLAGLAFAKKGRSLHVV-- 91 (340)
Q Consensus 25 ~~l~~sp~~~~~~~~~~~~~l~~g~~----------dg~i~i~d~~~~-~~~~~~~~~h~~~v~~v~~~~~~~~l~s~-- 91 (340)
-.+.|+|+|. +|++-.. -|...+|.+... .....+.-...++|.+++|+|+|+.++++
T Consensus 9 ~~~~W~~~G~---------~l~~~~~~~~~~~~ks~~~~~~l~~~~~~~~~~~~i~l~~~~~I~~~~WsP~g~~favi~g 79 (194)
T PF08662_consen 9 AKLHWQPSGD---------YLLVKVQTRVDKSGKSYYGEFELFYLNEKNIPVESIELKKEGPIHDVAWSPNGNEFAVIYG 79 (194)
T ss_pred EEEEecccCC---------EEEEEEEEeeccCcceEEeeEEEEEEecCCCccceeeccCCCceEEEEECcCCCEEEEEEc
Confidence 3588999996 4554322 134555555322 23333332245679999999999987655
Q ss_pred eCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec-----CcEEEEECCCCceeEEeecCCCCeEEEEECCC
Q 036605 92 GTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALAS-----SEVRILSLENGEEVLKFSDDVGPLQYVSASDG 166 (340)
Q Consensus 92 ~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~-----~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~ 166 (340)
..+..|.+||++ ++.+..+. ...+..+.|+|+|+++++++ ++|.+||.++.+.+..+. | ..+..++|+|+
T Consensus 80 ~~~~~v~lyd~~-~~~i~~~~--~~~~n~i~wsP~G~~l~~~g~~n~~G~l~~wd~~~~~~i~~~~-~-~~~t~~~WsPd 154 (194)
T PF08662_consen 80 SMPAKVTLYDVK-GKKIFSFG--TQPRNTISWSPDGRFLVLAGFGNLNGDLEFWDVRKKKKISTFE-H-SDATDVEWSPD 154 (194)
T ss_pred cCCcccEEEcCc-ccEeEeec--CCCceEEEECCCCCEEEEEEccCCCcEEEEEECCCCEEeeccc-c-CcEEEEEEcCC
Confidence 356799999997 66666654 56778999999999998864 349999999888776664 2 35789999999
Q ss_pred CCEEEEEEcC-----CCeEEEEEc
Q 036605 167 AKIIITAGYG-----EKHLQVWRC 185 (340)
Q Consensus 167 ~~~l~s~~~~-----d~~i~iwd~ 185 (340)
|++|+++... |+.++||++
T Consensus 155 Gr~~~ta~t~~r~~~dng~~Iw~~ 178 (194)
T PF08662_consen 155 GRYLATATTSPRLRVDNGFKIWSF 178 (194)
T ss_pred CCEEEEEEeccceeccccEEEEEe
Confidence 9999998763 788999998
No 187
>KOG1310 consensus WD40 repeat protein [General function prediction only]
Probab=99.65 E-value=2.4e-15 Score=128.12 Aligned_cols=212 Identities=14% Similarity=0.178 Sum_probs=148.2
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEec--CCCEEEEEeCCCc
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAK--KGRSLHVVGTNGM 96 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~--~~~~l~s~~~dg~ 96 (340)
+|.+.|.||+|+.+|. +|++|+.|-.+.|||....+.++.+..+|.+.|.++.|-| ..+.+++|+.|..
T Consensus 48 GH~GCVN~LeWn~dG~---------lL~SGSDD~r~ivWd~~~~KllhsI~TgHtaNIFsvKFvP~tnnriv~sgAgDk~ 118 (758)
T KOG1310|consen 48 GHTGCVNCLEWNADGE---------LLASGSDDTRLIVWDPFEYKLLHSISTGHTANIFSVKFVPYTNNRIVLSGAGDKL 118 (758)
T ss_pred cccceecceeecCCCC---------EEeecCCcceEEeecchhcceeeeeecccccceeEEeeeccCCCeEEEeccCcce
Confidence 8999999999999999 9999999999999999988888888777999999999998 4568999999999
Q ss_pred EEEEeCCCC----------eEEEEeecCCCCeeEEEEccCCCE-EEE--ecCcEEEEECCCCcee----------EEeec
Q 036605 97 ASEMKSEMG----------EVIREFKASEKPISSSAFLCEEKI-FAL--ASSEVRILSLENGEEV----------LKFSD 153 (340)
Q Consensus 97 i~~wd~~~~----------~~~~~~~~~~~~i~~l~~~~~~~~-l~~--~~~~i~i~d~~~~~~~----------~~~~~ 153 (340)
|+++|+... .....+..|...|..|+..|++.. +.+ -++.|+-||++....- ..+..
T Consensus 119 i~lfdl~~~~~~~~d~~~~~~~~~~~cht~rVKria~~p~~PhtfwsasEDGtirQyDiREph~c~p~~~~~~~l~ny~~ 198 (758)
T KOG1310|consen 119 IKLFDLDSSKEGGMDHGMEETTRCWSCHTDRVKRIATAPNGPHTFWSASEDGTIRQYDIREPHVCNPDEDCPSILVNYNP 198 (758)
T ss_pred EEEEecccccccccccCccchhhhhhhhhhhhhheecCCCCCceEEEecCCcceeeecccCCccCCccccccHHHHHhch
Confidence 999999852 233446778888999999999844 333 5566999999763211 11111
Q ss_pred CCCCeEEEEECCCCCE-EEEEEcCCCeEEEEEccCCCCCc------cC--------CceeeecCC---C-----eeeeee
Q 036605 154 DVGPLQYVSASDGAKI-IITAGYGEKHLQVWRCDISSKTV------NK--------GPALSMRHS---P-----VAIDCK 210 (340)
Q Consensus 154 ~~~~v~~~~~s~~~~~-l~s~~~~d~~i~iwd~~~~~~~~------~~--------~~~~~~~~~---~-----~~~~~~ 210 (340)
..-...++.++|...+ |+.|+. |-..++||.+...+.. .. ..-+.-+|. . .+..+.
T Consensus 199 ~lielk~ltisp~rp~~laVGgs-dpfarLYD~Rr~lks~~s~~~~~~~pp~~~~cv~yf~p~hlkn~~gn~~~~~~~~t 277 (758)
T KOG1310|consen 199 QLIELKCLTISPSRPYYLAVGGS-DPFARLYDRRRVLKSFRSDGTMNTCPPKDCRCVRYFSPGHLKNSQGNLDRYITCCT 277 (758)
T ss_pred hhheeeeeeecCCCCceEEecCC-CchhhhhhhhhhccCCCCCccccCCCCcccchhheecCccccCcccccccceeeeE
Confidence 2234567888887665 555555 9999999954221110 00 000111111 0 011111
Q ss_pred -cCCCCCCCCEEEEEeCCCcEEEEECCCCCcc
Q 036605 211 -NSPNGEDGTVILAVAESGVAYSWDLKTVSQD 241 (340)
Q Consensus 211 -~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~ 241 (340)
..| +|+|.-|+..-....|++||+...+..
T Consensus 278 ~vtf-npNGtElLvs~~gEhVYlfdvn~~~~~ 308 (758)
T KOG1310|consen 278 YVTF-NPNGTELLVSWGGEHVYLFDVNEDKSP 308 (758)
T ss_pred EEEE-CCCCcEEEEeeCCeEEEEEeecCCCCc
Confidence 123 788887777666667999999875543
No 188
>PRK03629 tolB translocation protein TolB; Provisional
Probab=99.65 E-value=1.8e-13 Score=121.74 Aligned_cols=194 Identities=13% Similarity=0.157 Sum_probs=129.6
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEc---CCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEE-eCCC
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGT---SNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVV-GTNG 95 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~---~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~-~~dg 95 (340)
+...+.+.+|||||+ .|+..+ .+..|++|++.+++.. .+.. ..+.+..++|+|||+.|+.. +.+|
T Consensus 197 ~~~~~~~p~wSPDG~---------~la~~s~~~g~~~i~i~dl~~G~~~-~l~~-~~~~~~~~~~SPDG~~La~~~~~~g 265 (429)
T PRK03629 197 SPQPLMSPAWSPDGS---------KLAYVTFESGRSALVIQTLANGAVR-QVAS-FPRHNGAPAFSPDGSKLAFALSKTG 265 (429)
T ss_pred CCCceeeeEEcCCCC---------EEEEEEecCCCcEEEEEECCCCCeE-EccC-CCCCcCCeEECCCCCEEEEEEcCCC
Confidence 456789999999997 676543 3457999999888643 3332 34445678999999988765 4444
Q ss_pred --cEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE-ecC----cEEEEECCCCceeEEeecCCCCeEEEEECCCCC
Q 036605 96 --MASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL-ASS----EVRILSLENGEEVLKFSDDVGPLQYVSASDGAK 168 (340)
Q Consensus 96 --~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~-~~~----~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~ 168 (340)
.|.+||+.+++... +..+...+....|+|||+.++. .+. .|+++|+.+++. ..+..+........|+|||+
T Consensus 266 ~~~I~~~d~~tg~~~~-lt~~~~~~~~~~wSPDG~~I~f~s~~~g~~~Iy~~d~~~g~~-~~lt~~~~~~~~~~~SpDG~ 343 (429)
T PRK03629 266 SLNLYVMDLASGQIRQ-VTDGRSNNTEPTWFPDSQNLAYTSDQAGRPQVYKVNINGGAP-QRITWEGSQNQDADVSSDGK 343 (429)
T ss_pred CcEEEEEECCCCCEEE-ccCCCCCcCceEECCCCCEEEEEeCCCCCceEEEEECCCCCe-EEeecCCCCccCEEECCCCC
Confidence 58999999887544 4444456788999999998865 322 277778877643 34444444556789999999
Q ss_pred EEEEEEcCC--CeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCc---EEEEECC
Q 036605 169 IIITAGYGE--KHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGV---AYSWDLK 236 (340)
Q Consensus 169 ~l~s~~~~d--~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~---i~vwd~~ 236 (340)
+|+..+..+ ..|.+||+ .+++.. .+. ..... ....| +|||..|+.++.++. ++++++.
T Consensus 344 ~Ia~~~~~~g~~~I~~~dl--~~g~~~-~Lt--~~~~~----~~p~~-SpDG~~i~~~s~~~~~~~l~~~~~~ 406 (429)
T PRK03629 344 FMVMVSSNGGQQHIAKQDL--ATGGVQ-VLT--DTFLD----ETPSI-APNGTMVIYSSSQGMGSVLNLVSTD 406 (429)
T ss_pred EEEEEEccCCCceEEEEEC--CCCCeE-EeC--CCCCC----CCceE-CCCCCEEEEEEcCCCceEEEEEECC
Confidence 998866533 35777787 344321 111 11111 11245 899999999998865 5666664
No 189
>PRK04922 tolB translocation protein TolB; Provisional
Probab=99.65 E-value=1.2e-13 Score=123.26 Aligned_cols=196 Identities=16% Similarity=0.118 Sum_probs=131.0
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCC---CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEE-EEeCC
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSN---GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLH-VVGTN 94 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~d---g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~-s~~~d 94 (340)
.+...+.+.+|+||++ .|+..+.+ ..|++||+.+++.. .+.. +.+...+++|+|||+.|+ +.+.+
T Consensus 201 ~~~~~v~~p~wSpDg~---------~la~~s~~~~~~~l~~~dl~~g~~~-~l~~-~~g~~~~~~~SpDG~~l~~~~s~~ 269 (433)
T PRK04922 201 RSAEPILSPAWSPDGK---------KLAYVSFERGRSAIYVQDLATGQRE-LVAS-FRGINGAPSFSPDGRRLALTLSRD 269 (433)
T ss_pred cCCCccccccCCCCCC---------EEEEEecCCCCcEEEEEECCCCCEE-Eecc-CCCCccCceECCCCCEEEEEEeCC
Confidence 4556789999999998 77776533 46999999888643 3433 455566889999999775 44555
Q ss_pred C--cEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec-C----cEEEEECCCCceeEEeecCCCCeEEEEECCCC
Q 036605 95 G--MASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALAS-S----EVRILSLENGEEVLKFSDDVGPLQYVSASDGA 167 (340)
Q Consensus 95 g--~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~-~----~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~ 167 (340)
| .|++||+.+++.. .+..+......++|+|||+.++..+ . +|+++|+.+++. ..+..+......++|+|+|
T Consensus 270 g~~~Iy~~d~~~g~~~-~lt~~~~~~~~~~~spDG~~l~f~sd~~g~~~iy~~dl~~g~~-~~lt~~g~~~~~~~~SpDG 347 (433)
T PRK04922 270 GNPEIYVMDLGSRQLT-RLTNHFGIDTEPTWAPDGKSIYFTSDRGGRPQIYRVAASGGSA-ERLTFQGNYNARASVSPDG 347 (433)
T ss_pred CCceEEEEECCCCCeE-ECccCCCCccceEECCCCCEEEEEECCCCCceEEEEECCCCCe-EEeecCCCCccCEEECCCC
Confidence 5 5999999988753 4555554556789999999887633 2 288888877653 3333333445578999999
Q ss_pred CEEEEEEcCCC--eEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCC---CcEEEEECCC
Q 036605 168 KIIITAGYGEK--HLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAES---GVAYSWDLKT 237 (340)
Q Consensus 168 ~~l~s~~~~d~--~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~d---g~i~vwd~~~ 237 (340)
++|+.....++ .|.+||+ .+++.. .+ .+...... ..| ++||.+++..+.+ +.|+++++..
T Consensus 348 ~~Ia~~~~~~~~~~I~v~d~--~~g~~~-~L----t~~~~~~~--p~~-spdG~~i~~~s~~~g~~~L~~~~~~g 412 (433)
T PRK04922 348 KKIAMVHGSGGQYRIAVMDL--STGSVR-TL----TPGSLDES--PSF-APNGSMVLYATREGGRGVLAAVSTDG 412 (433)
T ss_pred CEEEEEECCCCceeEEEEEC--CCCCeE-EC----CCCCCCCC--ceE-CCCCCEEEEEEecCCceEEEEEECCC
Confidence 99988655333 6888887 343321 11 11111111 245 8999988877653 3577777754
No 190
>COG2319 FOG: WD40 repeat [General function prediction only]
Probab=99.65 E-value=2.3e-13 Score=120.83 Aligned_cols=221 Identities=21% Similarity=0.330 Sum_probs=161.7
Q ss_pred CccCCCCc-eeeeeeCCCCCCCCCeEEEEe-eccccccccccCceEEEEE-cCCCcEEEEEccC-CeeEEEecCCCCCCe
Q 036605 1 IWSTNDGS-LLAEWKQPDGEPVVSYSCLAC-GFVGKKRRKERGTLLLALG-TSNGDILAVDVLT-GEMKWKSTGRHPGGL 76 (340)
Q Consensus 1 vwd~~~g~-~~~~~~~~~~~~~~~v~~l~~-sp~~~~~~~~~~~~~l~~g-~~dg~i~i~d~~~-~~~~~~~~~~h~~~v 76 (340)
+|+...+. ....+.. .+...+..+.+ ++++. .+++.. ..|+.+.+|+... ......+.. |...|
T Consensus 91 ~~~~~~~~~~~~~~~~---~~~~~~~~~~~~~~~~~--------~~~~~~~~~d~~~~~~~~~~~~~~~~~~~~-~~~~v 158 (466)
T COG2319 91 LWDLDNGEKLIKSLEG---LHDSSVSKLALSSPDGN--------SILLASSSLDGTVKLWDLSTPGKLIRTLEG-HSESV 158 (466)
T ss_pred EEEcCCCceeEEEEec---cCCCceeeEEEECCCcc--------eEEeccCCCCccEEEEEecCCCeEEEEEec-CcccE
Confidence 46666665 4455551 12246777777 55553 134443 4499999999988 667777777 99999
Q ss_pred EEEEEecCCCEEEEEeC-CCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCC-EEEE--ecCcEEEEECCCCceeE-Ee
Q 036605 77 AGLAFAKKGRSLHVVGT-NGMASEMKSEMGEVIREFKASEKPISSSAFLCEEK-IFAL--ASSEVRILSLENGEEVL-KF 151 (340)
Q Consensus 77 ~~v~~~~~~~~l~s~~~-dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~-~l~~--~~~~i~i~d~~~~~~~~-~~ 151 (340)
..++|+|++..+++++. |+.+++|++..+..+..+..|...+.+++++|++. .+++ .++.+++||...+..+. .+
T Consensus 159 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~~~~~~~~~~~~~~d~~i~~wd~~~~~~~~~~~ 238 (466)
T COG2319 159 TSLAFSPDGKLLASGSSLDGTIKLWDLRTGKPLSTLAGHTDPVSSLAFSPDGGLLIASGSSDGTIRLWDLSTGKLLRSTL 238 (466)
T ss_pred EEEEECCCCCEEEecCCCCCceEEEEcCCCceEEeeccCCCceEEEEEcCCcceEEEEecCCCcEEEEECCCCcEEeeec
Confidence 99999999998888885 99999999999888888888999999999999998 4444 33448999998777777 67
Q ss_pred ecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEE
Q 036605 152 SDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAY 231 (340)
Q Consensus 152 ~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~ 231 (340)
..|.... ...|++++.++++++. |+.+++|+++.... ....+ ..|...+..+ .+ .|++..+++++.|+.+.
T Consensus 239 ~~~~~~~-~~~~~~~~~~~~~~~~-d~~~~~~~~~~~~~---~~~~~-~~~~~~v~~~--~~-~~~~~~~~~~~~d~~~~ 309 (466)
T COG2319 239 SGHSDSV-VSSFSPDGSLLASGSS-DGTIRLWDLRSSSS---LLRTL-SGHSSSVLSV--AF-SPDGKLLASGSSDGTVR 309 (466)
T ss_pred CCCCcce-eEeECCCCCEEEEecC-CCcEEEeeecCCCc---EEEEE-ecCCccEEEE--EE-CCCCCEEEEeeCCCcEE
Confidence 8887775 4489999978887666 99999999842222 11111 2444444444 44 67778888899999999
Q ss_pred EEECCCCCccC
Q 036605 232 SWDLKTVSQDE 242 (340)
Q Consensus 232 vwd~~~~~~~~ 242 (340)
+|+........
T Consensus 310 ~~~~~~~~~~~ 320 (466)
T COG2319 310 LWDLETGKLLS 320 (466)
T ss_pred EEEcCCCceEE
Confidence 99887755443
No 191
>KOG1188 consensus WD40 repeat protein [General function prediction only]
Probab=99.64 E-value=7.3e-15 Score=118.22 Aligned_cols=172 Identities=11% Similarity=0.152 Sum_probs=126.3
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeecc--ccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecC-CCC-CCe
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFV--GKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTG-RHP-GGL 76 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~--~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~-~h~-~~v 76 (340)
+||..+|+.+.+|+ ++...+..+.|..+ .. .+.+|+.||+|++||++......++.. .++ .+.
T Consensus 54 lyd~~tg~~l~~fk----~~~~~~N~vrf~~~ds~h---------~v~s~ssDG~Vr~wD~Rs~~e~a~~~~~~~~~~~f 120 (376)
T KOG1188|consen 54 LYDKGTGQLLEEFK----GPPATTNGVRFISCDSPH---------GVISCSSDGTVRLWDIRSQAESARISWTQQSGTPF 120 (376)
T ss_pred EEeccchhhhheec----CCCCcccceEEecCCCCC---------eeEEeccCCeEEEEEeecchhhhheeccCCCCCcc
Confidence 57888999999998 78888889999764 35 799999999999999988764444432 244 355
Q ss_pred EEEEEecCCCEEEEEe----CCCcEEEEeCCCCeE-EEE-eecCCCCeeEEEEccCC-CEEEEecCc--EEEEECCCCce
Q 036605 77 AGLAFAKKGRSLHVVG----TNGMASEMKSEMGEV-IRE-FKASEKPISSSAFLCEE-KIFALASSE--VRILSLENGEE 147 (340)
Q Consensus 77 ~~v~~~~~~~~l~s~~----~dg~i~~wd~~~~~~-~~~-~~~~~~~i~~l~~~~~~-~~l~~~~~~--i~i~d~~~~~~ 147 (340)
.+++.+..++.+++|. .+-.|.+||++..+. +.. ...|...|+++.|+|.. .+|++++-+ |.+||+.....
T Consensus 121 ~~ld~nck~~ii~~GtE~~~s~A~v~lwDvR~~qq~l~~~~eSH~DDVT~lrFHP~~pnlLlSGSvDGLvnlfD~~~d~E 200 (376)
T KOG1188|consen 121 ICLDLNCKKNIIACGTELTRSDASVVLWDVRSEQQLLRQLNESHNDDVTQLRFHPSDPNLLLSGSVDGLVNLFDTKKDNE 200 (376)
T ss_pred eEeeccCcCCeEEeccccccCceEEEEEEeccccchhhhhhhhccCcceeEEecCCCCCeEEeecccceEEeeecCCCcc
Confidence 6777666677777764 356899999998765 333 56799999999999976 455665544 99999975422
Q ss_pred ---eEEeecCCCCeEEEEECCCC-CEEEEEEcCCCeEEEEEcc
Q 036605 148 ---VLKFSDDVGPLQYVSASDGA-KIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 148 ---~~~~~~~~~~v~~~~~s~~~-~~l~s~~~~d~~i~iwd~~ 186 (340)
+.....|...|..+.|...+ +.|.+ -.......+|++.
T Consensus 201 eDaL~~viN~~sSI~~igw~~~~ykrI~c-lTH~Etf~~~ele 242 (376)
T KOG1188|consen 201 EDALLHVINHGSSIHLIGWLSKKYKRIMC-LTHMETFAIYELE 242 (376)
T ss_pred hhhHHHhhcccceeeeeeeecCCcceEEE-EEccCceeEEEcc
Confidence 23334567789999998877 23444 3348889999884
No 192
>KOG1445 consensus Tumor-specific antigen (contains WD repeats) [Cytoskeleton]
Probab=99.64 E-value=6e-15 Score=127.81 Aligned_cols=186 Identities=15% Similarity=0.105 Sum_probs=132.9
Q ss_pred EEEE--EcCCCcEEEEEccCCee-----EEEecCCCCCCeEEEEEec-CCCEEEEEeCCCcEEEEeCCCCe-------EE
Q 036605 44 LLAL--GTSNGDILAVDVLTGEM-----KWKSTGRHPGGLAGLAFAK-KGRSLHVVGTNGMASEMKSEMGE-------VI 108 (340)
Q Consensus 44 ~l~~--g~~dg~i~i~d~~~~~~-----~~~~~~~h~~~v~~v~~~~-~~~~l~s~~~dg~i~~wd~~~~~-------~~ 108 (340)
++|+ .+..|.|-||++..... +-.+. ....|+.+.|+| |...|+.++.||.|++|.+..+. +.
T Consensus 593 rvAVPL~g~gG~iai~el~~PGrLPDgv~p~l~--Ngt~vtDl~WdPFD~~rLAVa~ddg~i~lWr~~a~gl~e~~~tPe 670 (1012)
T KOG1445|consen 593 RVAVPLAGSGGVIAIYELNEPGRLPDGVMPGLF--NGTLVTDLHWDPFDDERLAVATDDGQINLWRLTANGLPENEMTPE 670 (1012)
T ss_pred eEEEEecCCCceEEEEEcCCCCCCCcccccccc--cCceeeecccCCCChHHeeecccCceEEEEEeccCCCCcccCCcc
Confidence 4443 56679999999875421 11222 345799999999 77899999999999999987543 34
Q ss_pred EEeecCCCCeeEEEEccCC-CEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 109 REFKASEKPISSSAFLCEE-KIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 109 ~~~~~~~~~i~~l~~~~~~-~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
..++.|...|+++.|+|-- ..|++++.+ |++||+.+++....+.+|...|..++|+|+|+.+++.+. ||+|+||.-
T Consensus 671 ~~lt~h~eKI~slRfHPLAadvLa~asyd~Ti~lWDl~~~~~~~~l~gHtdqIf~~AWSpdGr~~AtVcK-Dg~~rVy~P 749 (1012)
T KOG1445|consen 671 KILTIHGEKITSLRFHPLAADVLAVASYDSTIELWDLANAKLYSRLVGHTDQIFGIAWSPDGRRIATVCK-DGTLRVYEP 749 (1012)
T ss_pred eeeecccceEEEEEecchhhhHhhhhhccceeeeeehhhhhhhheeccCcCceeEEEECCCCcceeeeec-CceEEEeCC
Confidence 4578899999999999953 445555444 999999999999999999999999999999999999888 999999997
Q ss_pred cCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCC----CcEEEEECCCC
Q 036605 186 DISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAES----GVAYSWDLKTV 238 (340)
Q Consensus 186 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~d----g~i~vwd~~~~ 238 (340)
+. ..+.+..-.-..+....-+ .| .-+|.++++.+.| ..|.+||..+.
T Consensus 750 rs-~e~pv~Eg~gpvgtRgARi----~w-acdgr~viv~Gfdk~SeRQv~~Y~Aq~l 800 (1012)
T KOG1445|consen 750 RS-REQPVYEGKGPVGTRGARI----LW-ACDGRIVIVVGFDKSSERQVQMYDAQTL 800 (1012)
T ss_pred CC-CCCccccCCCCccCcceeE----EE-EecCcEEEEecccccchhhhhhhhhhhc
Confidence 42 1111111111111111111 33 4577777777655 45777876653
No 193
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=99.63 E-value=2e-13 Score=105.28 Aligned_cols=148 Identities=14% Similarity=0.181 Sum_probs=117.8
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEe
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMK 101 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd 101 (340)
-.|++|...|... -++.++.|+.++.||+++|+....+.+ |++.|.++.--.....+++|+.||++++||
T Consensus 115 PeINam~ldP~en---------Si~~AgGD~~~y~~dlE~G~i~r~~rG-HtDYvH~vv~R~~~~qilsG~EDGtvRvWd 184 (325)
T KOG0649|consen 115 PEINAMWLDPSEN---------SILFAGGDGVIYQVDLEDGRIQREYRG-HTDYVHSVVGRNANGQILSGAEDGTVRVWD 184 (325)
T ss_pred CccceeEeccCCC---------cEEEecCCeEEEEEEecCCEEEEEEcC-CcceeeeeeecccCcceeecCCCccEEEEe
Confidence 3678888888774 355556899999999999999999999 999999999855566899999999999999
Q ss_pred CCCCeEEEEeecCC----------CCeeEEEEccCCCEEEEecCc-EEEEECCCCceeEEeecCCCCeEEEEECCCCCEE
Q 036605 102 SEMGEVIREFKASE----------KPISSSAFLCEEKIFALASSE-VRILSLENGEEVLKFSDDVGPLQYVSASDGAKII 170 (340)
Q Consensus 102 ~~~~~~~~~~~~~~----------~~i~~l~~~~~~~~l~~~~~~-i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l 170 (340)
.++++.+..+...+ .-|-+++ -+..+++++++. +.+|.+++.+....|.. +..+..+.|..+ .+
T Consensus 185 ~kt~k~v~~ie~yk~~~~lRp~~g~wigala--~~edWlvCGgGp~lslwhLrsse~t~vfpi-pa~v~~v~F~~d--~v 259 (325)
T KOG0649|consen 185 TKTQKHVSMIEPYKNPNLLRPDWGKWIGALA--VNEDWLVCGGGPKLSLWHLRSSESTCVFPI-PARVHLVDFVDD--CV 259 (325)
T ss_pred ccccceeEEeccccChhhcCcccCceeEEEe--ccCceEEecCCCceeEEeccCCCceEEEec-ccceeEeeeecc--eE
Confidence 99999887754321 1234444 456688887776 99999999988877753 567888888655 57
Q ss_pred EEEEcCCCeEEEEEc
Q 036605 171 ITAGYGEKHLQVWRC 185 (340)
Q Consensus 171 ~s~~~~d~~i~iwd~ 185 (340)
++++. .+.|.-|.+
T Consensus 260 l~~G~-g~~v~~~~l 273 (325)
T KOG0649|consen 260 LIGGE-GNHVQSYTL 273 (325)
T ss_pred EEecc-ccceeeeee
Confidence 77777 789999987
No 194
>KOG1272 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.62 E-value=6.2e-16 Score=129.01 Aligned_cols=203 Identities=14% Similarity=0.190 Sum_probs=158.4
Q ss_pred ccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEE
Q 036605 2 WSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAF 81 (340)
Q Consensus 2 wd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~ 81 (340)
+|..++.+..++. .-..|..+.|-.+.. ++|++ ....++|||- .|..++.+.. | ..|..+.|
T Consensus 156 ~Dw~t~~L~~Ei~-----v~Etv~Dv~~LHneq---------~~AVA-QK~y~yvYD~-~GtElHClk~-~-~~v~rLeF 217 (545)
T KOG1272|consen 156 FDWVTKKLHFEIN-----VMETVRDVTFLHNEQ---------FFAVA-QKKYVYVYDN-NGTELHCLKR-H-IRVARLEF 217 (545)
T ss_pred eecccceeeeeee-----hhhhhhhhhhhcchH---------HHHhh-hhceEEEecC-CCcEEeehhh-c-Cchhhhcc
Confidence 4666777777665 347788889988777 66665 5678999994 4666777775 4 48999999
Q ss_pred ecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE--ecCcEEEEECCCCceeEEeecCCCCeE
Q 036605 82 AKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL--ASSEVRILSLENGEEVLKFSDDVGPLQ 159 (340)
Q Consensus 82 ~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~--~~~~i~i~d~~~~~~~~~~~~~~~~v~ 159 (340)
-|..-+|++++..|.+..-|+.+|+.+..+....+.+..+..+|-...+-+ +.++|.+|...+.+++.++..|.++|.
T Consensus 218 LPyHfLL~~~~~~G~L~Y~DVS~GklVa~~~t~~G~~~vm~qNP~NaVih~GhsnGtVSlWSP~skePLvKiLcH~g~V~ 297 (545)
T KOG1272|consen 218 LPYHFLLVAASEAGFLKYQDVSTGKLVASIRTGAGRTDVMKQNPYNAVIHLGHSNGTVSLWSPNSKEPLVKILCHRGPVS 297 (545)
T ss_pred cchhheeeecccCCceEEEeechhhhhHHHHccCCccchhhcCCccceEEEcCCCceEEecCCCCcchHHHHHhcCCCcc
Confidence 998888999999999999999999999998888888999999998877766 455699999999999999999999999
Q ss_pred EEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEE
Q 036605 160 YVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWD 234 (340)
Q Consensus 160 ~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd 234 (340)
++++.++|.|++++|. |+.++|||+|. ..+. .... ..++....++ +..| +++.+....|.+|.
T Consensus 298 siAv~~~G~YMaTtG~-Dr~~kIWDlR~-~~ql-~t~~--tp~~a~~ls~-----Sqkg--lLA~~~G~~v~iw~ 360 (545)
T KOG1272|consen 298 SIAVDRGGRYMATTGL-DRKVKIWDLRN-FYQL-HTYR--TPHPASNLSL-----SQKG--LLALSYGDHVQIWK 360 (545)
T ss_pred eEEECCCCcEEeeccc-ccceeEeeecc-cccc-ceee--cCCCcccccc-----cccc--ceeeecCCeeeeeh
Confidence 9999999999999999 99999999963 2222 2221 1343333333 3333 55556666799994
No 195
>KOG1538 consensus Uncharacterized conserved protein WDR10, contains WD40 repeats [General function prediction only]
Probab=99.62 E-value=2.6e-14 Score=124.60 Aligned_cols=214 Identities=13% Similarity=0.096 Sum_probs=154.3
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeC
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKS 102 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~ 102 (340)
.|..++|-|||. .|+.+. +..+.+||+..|..+.++++ |.+.|+|++|+.||+.+++|+.|..|.+|+.
T Consensus 14 ci~d~afkPDGs---------qL~lAA-g~rlliyD~ndG~llqtLKg-HKDtVycVAys~dGkrFASG~aDK~VI~W~~ 82 (1081)
T KOG1538|consen 14 CINDIAFKPDGT---------QLILAA-GSRLLVYDTSDGTLLQPLKG-HKDTVYCVAYAKDGKRFASGSADKSVIIWTS 82 (1081)
T ss_pred chheeEECCCCc---------eEEEec-CCEEEEEeCCCccccccccc-ccceEEEEEEccCCceeccCCCceeEEEecc
Confidence 788999999996 565554 44799999999999999999 9999999999999999999999999999985
Q ss_pred CCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc-EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEE
Q 036605 103 EMGEVIREFKASEKPISSSAFLCEEKIFALASSE-VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQ 181 (340)
Q Consensus 103 ~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~-i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~ 181 (340)
.-.- +.+ ..|...|.|+.|+|-...|++++-. .-+|...... +.+.. ....+.+.+|..||+|++.+-. +|+|.
T Consensus 83 klEG-~Lk-YSH~D~IQCMsFNP~~h~LasCsLsdFglWS~~qK~-V~K~k-ss~R~~~CsWtnDGqylalG~~-nGTIs 157 (1081)
T KOG1538|consen 83 KLEG-ILK-YSHNDAIQCMSFNPITHQLASCSLSDFGLWSPEQKS-VSKHK-SSSRIICCSWTNDGQYLALGMF-NGTIS 157 (1081)
T ss_pred cccc-eee-eccCCeeeEeecCchHHHhhhcchhhccccChhhhh-HHhhh-hheeEEEeeecCCCcEEEEecc-CceEE
Confidence 4221 222 2588899999999999999886644 8889876543 22222 2356888999999999999766 99999
Q ss_pred EEEccCCCCCccCCceeeecCCCeeeeeecCCCC--CCCCEEEEEeCCCcEEEEECCC---C-CccCCCCCceEEEeecc
Q 036605 182 VWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNG--EDGTVILAVAESGVAYSWDLKT---V-SQDEKTNPAKITVKLKK 255 (340)
Q Consensus 182 iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~--~~~~~l~~~s~dg~i~vwd~~~---~-~~~~~~~p~~i~~~~~~ 255 (340)
|-+- .++....+.-+-+....++.+.++..+ .....+++.....++.+|.+.. + +..-.+.|+.++.-..+
T Consensus 158 iRNk---~gEek~~I~Rpgg~Nspiwsi~~~p~sg~G~~di~aV~DW~qTLSFy~LsG~~Igk~r~L~FdP~CisYf~NG 234 (1081)
T KOG1538|consen 158 IRNK---NGEEKVKIERPGGSNSPIWSICWNPSSGEGRNDILAVADWGQTLSFYQLSGKQIGKDRALNFDPCCISYFTNG 234 (1081)
T ss_pred eecC---CCCcceEEeCCCCCCCCceEEEecCCCCCCccceEEEEeccceeEEEEecceeecccccCCCCchhheeccCC
Confidence 8864 444333332222333444444222221 2235788888899999998865 1 22223778777765443
No 196
>KOG0322 consensus G-protein beta subunit-like protein GNB1L, contains WD repeats [General function prediction only]
Probab=99.62 E-value=1.2e-14 Score=113.03 Aligned_cols=158 Identities=16% Similarity=0.215 Sum_probs=122.8
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEE----------EecCCCCCCeEEEEEecCCCEEE
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKW----------KSTGRHPGGLAGLAFAKKGRSLH 89 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~----------~~~~~h~~~v~~v~~~~~~~~l~ 89 (340)
..+.++|..|-.... ...+|++|..+|.+.+||+.++..+. .... |..+|.++.+.+.-..=+
T Consensus 149 Klgsvmc~~~~~~c~------s~~lllaGyEsghvv~wd~S~~~~~~~~~~~~kv~~~~as-h~qpvlsldyas~~~rGi 221 (323)
T KOG0322|consen 149 KLGSVMCQDKDHACG------STFLLLAGYESGHVVIWDLSTGDKIIQLPQSSKVESPNAS-HKQPVLSLDYASSCDRGI 221 (323)
T ss_pred ccCceeeeecccccc------ceEEEEEeccCCeEEEEEccCCceeeccccccccccchhh-ccCcceeeeechhhcCCc
Confidence 346677777643332 13478899999999999999984332 2333 899999999987655667
Q ss_pred EEeCCCcEEEEeCCCC--eE--EEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEE
Q 036605 90 VVGTNGMASEMKSEMG--EV--IREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSA 163 (340)
Q Consensus 90 s~~~dg~i~~wd~~~~--~~--~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~ 163 (340)
+++.+..+..|++... .. .....-..-.+..+.+-||++++++++-+ |++|..++..++..+..|...|.+++|
T Consensus 222 sgga~dkl~~~Sl~~s~gslq~~~e~~lknpGv~gvrIRpD~KIlATAGWD~RiRVyswrtl~pLAVLkyHsagvn~vAf 301 (323)
T KOG0322|consen 222 SGGADDKLVMYSLNHSTGSLQIRKEITLKNPGVSGVRIRPDGKILATAGWDHRIRVYSWRTLNPLAVLKYHSAGVNAVAF 301 (323)
T ss_pred CCCccccceeeeeccccCcccccceEEecCCCccceEEccCCcEEeecccCCcEEEEEeccCCchhhhhhhhcceeEEEe
Confidence 7888888889887643 21 11233334568889999999999997655 999999999999999999999999999
Q ss_pred CCCCCEEEEEEcCCCeEEEEEc
Q 036605 164 SDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 164 s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
+|+...+++++. |.+|.+|++
T Consensus 302 spd~~lmAaask-D~rISLWkL 322 (323)
T KOG0322|consen 302 SPDCELMAAASK-DARISLWKL 322 (323)
T ss_pred CCCCchhhhccC-CceEEeeec
Confidence 999888888777 999999986
No 197
>KOG4227 consensus WD40 repeat protein [General function prediction only]
Probab=99.60 E-value=1.5e-13 Score=112.77 Aligned_cols=161 Identities=11% Similarity=0.028 Sum_probs=127.4
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC------CeeEEEecCCCCCCeEEEEEecCCCEEEEEe
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT------GEMKWKSTGRHPGGLAGLAFAKKGRSLHVVG 92 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~------~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~ 92 (340)
+|.+.|.++.||.+++ +|++|+.|..+++|+++. .+.+......|...|.|++|......|++|+
T Consensus 54 ~H~GCiNAlqFS~N~~---------~L~SGGDD~~~~~W~~de~~~~k~~KPI~~~~~~H~SNIF~L~F~~~N~~~~SG~ 124 (609)
T KOG4227|consen 54 EHTGCINALQFSHNDR---------FLASGGDDMHGRVWNVDELMVRKTPKPIGVMEHPHRSNIFSLEFDLENRFLYSGE 124 (609)
T ss_pred hhccccceeeeccCCe---------EEeecCCcceeeeechHHHHhhcCCCCceeccCccccceEEEEEccCCeeEecCC
Confidence 7889999999999999 999999999999999763 2334333334778999999999889999999
Q ss_pred CCCcEEEEeCCCCeEEEEeec--CCCCeeEEEEccCCCEEEEecCc--EEEEECCCCc-ee--EEeecCCCCeEEEEECC
Q 036605 93 TNGMASEMKSEMGEVIREFKA--SEKPISSSAFLCEEKIFALASSE--VRILSLENGE-EV--LKFSDDVGPLQYVSASD 165 (340)
Q Consensus 93 ~dg~i~~wd~~~~~~~~~~~~--~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~-~~--~~~~~~~~~v~~~~~s~ 165 (340)
.+++|...|+.+.+.+..+.. ..+.|+.+..+|..+.+++.... |.+||.+... .+ ............+.|+|
T Consensus 125 ~~~~VI~HDiEt~qsi~V~~~~~~~~~VY~m~~~P~DN~~~~~t~~~~V~~~D~Rd~~~~~~~~~~AN~~~~F~t~~F~P 204 (609)
T KOG4227|consen 125 RWGTVIKHDIETKQSIYVANENNNRGDVYHMDQHPTDNTLIVVTRAKLVSFIDNRDRQNPISLVLPANSGKNFYTAEFHP 204 (609)
T ss_pred CcceeEeeecccceeeeeecccCcccceeecccCCCCceEEEEecCceEEEEeccCCCCCCceeeecCCCccceeeeecC
Confidence 999999999999888776643 23489999999998888775544 9999998654 22 22233445677889999
Q ss_pred CCCEEEEEEcCCCeEEEEEccCC
Q 036605 166 GAKIIITAGYGEKHLQVWRCDIS 188 (340)
Q Consensus 166 ~~~~l~s~~~~d~~i~iwd~~~~ 188 (340)
....|+......+-+.+||.+..
T Consensus 205 ~~P~Li~~~~~~~G~~~~D~R~~ 227 (609)
T KOG4227|consen 205 ETPALILVNSETGGPNVFDRRMQ 227 (609)
T ss_pred CCceeEEeccccCCCCceeeccc
Confidence 88776666665888999998643
No 198
>PRK02889 tolB translocation protein TolB; Provisional
Probab=99.60 E-value=7.4e-13 Score=117.85 Aligned_cols=194 Identities=15% Similarity=0.111 Sum_probs=123.4
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCC---CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEE-EEeCC
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSN---GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLH-VVGTN 94 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~d---g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~-s~~~d 94 (340)
.+...+.+.+|+|||+ .|+..+.+ ..|++||+.+++.. .+.. ..+.+...+|+|||+.|+ +.+.+
T Consensus 193 ~~~~~v~~p~wSPDG~---------~la~~s~~~~~~~I~~~dl~~g~~~-~l~~-~~g~~~~~~~SPDG~~la~~~~~~ 261 (427)
T PRK02889 193 SSPEPIISPAWSPDGT---------KLAYVSFESKKPVVYVHDLATGRRR-VVAN-FKGSNSAPAWSPDGRTLAVALSRD 261 (427)
T ss_pred cCCCCcccceEcCCCC---------EEEEEEccCCCcEEEEEECCCCCEE-Eeec-CCCCccceEECCCCCEEEEEEccC
Confidence 3556788999999998 67766532 45999999988754 3443 445677899999999876 45667
Q ss_pred CcEEEE--eCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec---Cc--EEEEECCCCceeEEeecCCCCeEEEEECCCC
Q 036605 95 GMASEM--KSEMGEVIREFKASEKPISSSAFLCEEKIFALAS---SE--VRILSLENGEEVLKFSDDVGPLQYVSASDGA 167 (340)
Q Consensus 95 g~i~~w--d~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~---~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~ 167 (340)
|...+| |+.++. ...+..+........|+|||+.++..+ +. |+++++.++.. ..+...........|+|+|
T Consensus 262 g~~~Iy~~d~~~~~-~~~lt~~~~~~~~~~wSpDG~~l~f~s~~~g~~~Iy~~~~~~g~~-~~lt~~g~~~~~~~~SpDG 339 (427)
T PRK02889 262 GNSQIYTVNADGSG-LRRLTQSSGIDTEPFFSPDGRSIYFTSDRGGAPQIYRMPASGGAA-QRVTFTGSYNTSPRISPDG 339 (427)
T ss_pred CCceEEEEECCCCC-cEECCCCCCCCcCeEEcCCCCEEEEEecCCCCcEEEEEECCCCce-EEEecCCCCcCceEECCCC
Confidence 765555 555554 445555555566788999999886532 22 66666666543 2232223334567899999
Q ss_pred CEEEEEEcCCC--eEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCC---cEEEEEC
Q 036605 168 KIIITAGYGEK--HLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESG---VAYSWDL 235 (340)
Q Consensus 168 ~~l~s~~~~d~--~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg---~i~vwd~ 235 (340)
++|+..+..++ .|.+||+ .+++.. .+. .. ..... ..| +|||..|+.++.++ .+++.++
T Consensus 340 ~~Ia~~s~~~g~~~I~v~d~--~~g~~~-~lt---~~-~~~~~--p~~-spdg~~l~~~~~~~g~~~l~~~~~ 402 (427)
T PRK02889 340 KLLAYISRVGGAFKLYVQDL--ATGQVT-ALT---DT-TRDES--PSF-APNGRYILYATQQGGRSVLAAVSS 402 (427)
T ss_pred CEEEEEEccCCcEEEEEEEC--CCCCeE-Ecc---CC-CCccC--ceE-CCCCCEEEEEEecCCCEEEEEEEC
Confidence 99987665233 6889998 343321 111 11 11111 245 89999888877654 2444454
No 199
>KOG2111 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=99.59 E-value=1.4e-12 Score=104.39 Aligned_cols=169 Identities=15% Similarity=0.172 Sum_probs=127.1
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEcc-CCeeEEEecCC-CCCCeEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVL-TGEMKWKSTGR-HPGGLAG 78 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~-~~~~~~~~~~~-h~~~v~~ 78 (340)
|||-....++.++. ...+|..+.++++ .+++. ..+.|++|... +.+.++.+... .+..+.+
T Consensus 79 IWDD~k~~~i~el~-----f~~~I~~V~l~r~-----------riVvv-l~~~I~VytF~~n~k~l~~~et~~NPkGlC~ 141 (346)
T KOG2111|consen 79 IWDDLKERCIIELS-----FNSEIKAVKLRRD-----------RIVVV-LENKIYVYTFPDNPKLLHVIETRSNPKGLCS 141 (346)
T ss_pred EEecccCcEEEEEE-----eccceeeEEEcCC-----------eEEEE-ecCeEEEEEcCCChhheeeeecccCCCceEe
Confidence 68866666666665 5588999988853 34444 36689999987 45555555431 2444555
Q ss_pred EEEecCCCEEEEEe-CCCcEEEEeCCCCeE--EEEeecCCCCeeEEEEccCCCEEEEecCc---EEEEECCCCceeEEee
Q 036605 79 LAFAKKGRSLHVVG-TNGMASEMKSEMGEV--IREFKASEKPISSSAFLCEEKIFALASSE---VRILSLENGEEVLKFS 152 (340)
Q Consensus 79 v~~~~~~~~l~s~~-~dg~i~~wd~~~~~~--~~~~~~~~~~i~~l~~~~~~~~l~~~~~~---i~i~d~~~~~~~~~~~ 152 (340)
++-+.+...|+.-| .-|.|.+-|+...+. ...+.+|...|.|++++.+|..+|+++.. |+|||..+|+.+.++.
T Consensus 142 ~~~~~~k~~LafPg~k~GqvQi~dL~~~~~~~p~~I~AH~s~Iacv~Ln~~Gt~vATaStkGTLIRIFdt~~g~~l~E~R 221 (346)
T KOG2111|consen 142 LCPTSNKSLLAFPGFKTGQVQIVDLASTKPNAPSIINAHDSDIACVALNLQGTLVATASTKGTLIRIFDTEDGTLLQELR 221 (346)
T ss_pred ecCCCCceEEEcCCCccceEEEEEhhhcCcCCceEEEcccCceeEEEEcCCccEEEEeccCcEEEEEEEcCCCcEeeeee
Confidence 55443444555544 349999999886655 36688999999999999999999997765 9999999999999884
Q ss_pred c--CCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccC
Q 036605 153 D--DVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDI 187 (340)
Q Consensus 153 ~--~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~ 187 (340)
- ....|.+++|||++.+|++++. .|+++||.++.
T Consensus 222 RG~d~A~iy~iaFSp~~s~LavsSd-KgTlHiF~l~~ 257 (346)
T KOG2111|consen 222 RGVDRADIYCIAFSPNSSWLAVSSD-KGTLHIFSLRD 257 (346)
T ss_pred cCCchheEEEEEeCCCccEEEEEcC-CCeEEEEEeec
Confidence 3 2367999999999999999777 99999999964
No 200
>KOG0642 consensus Cell-cycle nuclear protein, contains WD-40 repeats [Cell cycle control, cell division, chromosome partitioning]
Probab=99.59 E-value=4.9e-14 Score=120.47 Aligned_cols=162 Identities=12% Similarity=0.166 Sum_probs=127.9
Q ss_pred eeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCC----------eeEEEecCCCCCCeEE
Q 036605 9 LLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTG----------EMKWKSTGRHPGGLAG 78 (340)
Q Consensus 9 ~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~----------~~~~~~~~~h~~~v~~ 78 (340)
.+.+|. +|.++|.|++..+++. .+++|+-||+|+.|++... .....+.+ |.+.|+.
T Consensus 336 pi~tfr----aH~gPVl~v~v~~n~~---------~~ysgg~Dg~I~~w~~p~n~dp~ds~dp~vl~~~l~G-htdavw~ 401 (577)
T KOG0642|consen 336 PILTFR----AHEGPVLCVVVPSNGE---------HCYSGGIDGTIRCWNLPPNQDPDDSYDPSVLSGTLLG-HTDAVWL 401 (577)
T ss_pred eeEEEe----cccCceEEEEecCCce---------EEEeeccCceeeeeccCCCCCcccccCcchhccceec-cccceee
Confidence 335666 8999999999999998 8999999999999965421 12345566 9999999
Q ss_pred EEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEe---------------------------------------------ec
Q 036605 79 LAFAKKGRSLHVVGTNGMASEMKSEMGEVIREF---------------------------------------------KA 113 (340)
Q Consensus 79 v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~---------------------------------------------~~ 113 (340)
+++|+....|++|+.||+++.|+.....+ ..| ..
T Consensus 402 l~~s~~~~~Llscs~DgTvr~w~~~~~~~-~~f~~~~e~g~Plsvd~~ss~~a~~~~s~~~~~~~~~~~ev~s~~~~~~s 480 (577)
T KOG0642|consen 402 LALSSTKDRLLSCSSDGTVRLWEPTEESP-CTFGEPKEHGYPLSVDRTSSRPAHSLASFRFGYTSIDDMEVVSDLLIFES 480 (577)
T ss_pred eeecccccceeeecCCceEEeeccCCcCc-cccCCccccCCcceEeeccchhHhhhhhcccccccchhhhhhhheeeccc
Confidence 99999888999999999999998754332 100 00
Q ss_pred -------CCCCeeEEEEccCCCEEEEec--CcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEE
Q 036605 114 -------SEKPISSSAFLCEEKIFALAS--SEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWR 184 (340)
Q Consensus 114 -------~~~~i~~l~~~~~~~~l~~~~--~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd 184 (340)
....+..+..+|...+.+++. +.|+++|..+++.+.....|...++++++.|+|.+|++++. |+.+++|.
T Consensus 481 ~~~~~~~~~~~in~vVs~~~~~~~~~~hed~~Ir~~dn~~~~~l~s~~a~~~svtslai~~ng~~l~s~s~-d~sv~l~k 559 (577)
T KOG0642|consen 481 SASPGPRRYPQINKVVSHPTADITFTAHEDRSIRFFDNKTGKILHSMVAHKDSVTSLAIDPNGPYLMSGSH-DGSVRLWK 559 (577)
T ss_pred cCCCcccccCccceEEecCCCCeeEecccCCceecccccccccchheeeccceecceeecCCCceEEeecC-Cceeehhh
Confidence 011234455666666666643 34999999999999999999999999999999999999777 99999999
Q ss_pred cc
Q 036605 185 CD 186 (340)
Q Consensus 185 ~~ 186 (340)
++
T Consensus 560 ld 561 (577)
T KOG0642|consen 560 LD 561 (577)
T ss_pred cc
Confidence 83
No 201
>KOG0650 consensus WD40 repeat nucleolar protein Bop1, involved in ribosome biogenesis [Translation, ribosomal structure and biogenesis]
Probab=99.59 E-value=2e-14 Score=123.66 Aligned_cols=200 Identities=11% Similarity=0.049 Sum_probs=156.0
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCC---CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCC
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSN---GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNG 95 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~d---g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg 95 (340)
.|...|..+.|+..|. ||++...+ ..|.|+++........|.. -.+.|.++.|+|...+|+.++..
T Consensus 519 ~~~k~i~~vtWHrkGD---------YlatV~~~~~~~~VliHQLSK~~sQ~PF~k-skG~vq~v~FHPs~p~lfVaTq~- 587 (733)
T KOG0650|consen 519 KHPKSIRQVTWHRKGD---------YLATVMPDSGNKSVLIHQLSKRKSQSPFRK-SKGLVQRVKFHPSKPYLFVATQR- 587 (733)
T ss_pred ecCCccceeeeecCCc---------eEEEeccCCCcceEEEEecccccccCchhh-cCCceeEEEecCCCceEEEEecc-
Confidence 3778999999999999 99987654 5789999988877767765 66789999999999898887655
Q ss_pred cEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCC-ceeEEeecCCCCeEEEEECCCCCEEEE
Q 036605 96 MASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENG-EEVLKFSDDVGPLQYVSASDGAKIIIT 172 (340)
Q Consensus 96 ~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~-~~~~~~~~~~~~v~~~~~s~~~~~l~s 172 (340)
.|++||+..+..+.++......|..++++|.|..|+.++.+ +..||+.-. ++.+.+..|...+++++|++.-..+++
T Consensus 588 ~vRiYdL~kqelvKkL~tg~kwiS~msihp~GDnli~gs~d~k~~WfDldlsskPyk~lr~H~~avr~Va~H~ryPLfas 667 (733)
T KOG0650|consen 588 SVRIYDLSKQELVKKLLTGSKWISSMSIHPNGDNLILGSYDKKMCWFDLDLSSKPYKTLRLHEKAVRSVAFHKRYPLFAS 667 (733)
T ss_pred ceEEEehhHHHHHHHHhcCCeeeeeeeecCCCCeEEEecCCCeeEEEEcccCcchhHHhhhhhhhhhhhhhccccceeee
Confidence 89999999887777776667789999999999888887766 888998754 455778889999999999999888888
Q ss_pred EEcCCCeEEEEEccCCCCC----ccCCceeeecCCCe----eeeeecCCCCCCCCEEEEEeCCCcEEEE
Q 036605 173 AGYGEKHLQVWRCDISSKT----VNKGPALSMRHSPV----AIDCKNSPNGEDGTVILAVAESGVAYSW 233 (340)
Q Consensus 173 ~~~~d~~i~iwd~~~~~~~----~~~~~~~~~~~~~~----~~~~~~~~~~~~~~~l~~~s~dg~i~vw 233 (340)
++. |+++.||--...+.- .+-.+...-+|... +.++ .| +|...+|++++.||.|++|
T Consensus 668 ~sd-Dgtv~Vfhg~VY~Dl~qnpliVPlK~L~gH~~~~~~gVLd~--~w-HP~qpWLfsAGAd~tirlf 732 (733)
T KOG0650|consen 668 GSD-DGTVIVFHGMVYNDLLQNPLIVPLKRLRGHEKTNDLGVLDT--IW-HPRQPWLFSAGADGTIRLF 732 (733)
T ss_pred ecC-CCcEEEEeeeeehhhhcCCceEeeeeccCceeecccceEee--cc-cCCCceEEecCCCceEEee
Confidence 776 999999864222211 11111111134332 4444 77 9999999999999999998
No 202
>KOG0644 consensus Uncharacterized conserved protein, contains WD40 repeat and BROMO domains [General function prediction only]
Probab=99.56 E-value=1.8e-14 Score=128.42 Aligned_cols=201 Identities=13% Similarity=0.145 Sum_probs=152.6
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
+|-..|.|..|...|+ ++++|+.|..++||..+++.++..+.+ |.+.|+.++.+.....+++++.|..|+
T Consensus 188 gH~naVyca~fDrtg~---------~Iitgsdd~lvKiwS~et~~~lAs~rG-hs~ditdlavs~~n~~iaaaS~D~vIr 257 (1113)
T KOG0644|consen 188 GHRNAVYCAIFDRTGR---------YIITGSDDRLVKIWSMETARCLASCRG-HSGDITDLAVSSNNTMIAAASNDKVIR 257 (1113)
T ss_pred hhhhheeeeeeccccc---------eEeecCccceeeeeeccchhhhccCCC-CccccchhccchhhhhhhhcccCceEE
Confidence 6888999999999999 999999999999999999999999999 999999999998888999999999999
Q ss_pred EEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCcEEEEECC-----------------------------------
Q 036605 99 EMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSEVRILSLE----------------------------------- 143 (340)
Q Consensus 99 ~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~i~i~d~~----------------------------------- 143 (340)
+|-+.++.++..+.+|.+.|++|+|+|-. -...++++++||.+
T Consensus 258 vWrl~~~~pvsvLrghtgavtaiafsP~~--sss~dgt~~~wd~r~~~~~y~prp~~~~~~~~~~s~~~~~~~~~f~Tgs 335 (1113)
T KOG0644|consen 258 VWRLPDGAPVSVLRGHTGAVTAIAFSPRA--SSSDDGTCRIWDARLEPRIYVPRPLKFTEKDLVDSILFENNGDRFLTGS 335 (1113)
T ss_pred EEecCCCchHHHHhccccceeeeccCccc--cCCCCCceEeccccccccccCCCCCCcccccceeeeecccccccccccc
Confidence 99999999999999999999999999743 00123334444443
Q ss_pred ------------------------------------------------CCceeEEeecCCCCeEEEEECCCCCEEEEEEc
Q 036605 144 ------------------------------------------------NGEEVLKFSDDVGPLQYVSASDGAKIIITAGY 175 (340)
Q Consensus 144 ------------------------------------------------~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~ 175 (340)
+|..+..+.+|...+..+.++|-+..++..+.
T Consensus 336 ~d~ea~n~e~~~l~~~~~~lif~t~ssd~~~~~~~ar~~~~~~vwnl~~g~l~H~l~ghsd~~yvLd~Hpfn~ri~msag 415 (1113)
T KOG0644|consen 336 RDGEARNHEFEQLAWRSNLLIFVTRSSDLSSIVVTARNDHRLCVWNLYTGQLLHNLMGHSDEVYVLDVHPFNPRIAMSAG 415 (1113)
T ss_pred CCcccccchhhHhhhhccceEEEeccccccccceeeeeeeEeeeeecccchhhhhhcccccceeeeeecCCCcHhhhhcc
Confidence 33333333345566666777776666555444
Q ss_pred CCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCC
Q 036605 176 GEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVS 239 (340)
Q Consensus 176 ~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~ 239 (340)
.||...|||+ ..+....... .+| ....+ +.| +++|..++....-|.++|.....++
T Consensus 416 ~dgst~iwdi--~eg~pik~y~--~gh-~kl~d--~kF-Sqdgts~~lsd~hgql~i~g~gqs~ 471 (1113)
T KOG0644|consen 416 YDGSTIIWDI--WEGIPIKHYF--IGH-GKLVD--GKF-SQDGTSIALSDDHGQLYILGTGQSK 471 (1113)
T ss_pred CCCceEeeec--ccCCcceeee--ccc-ceeec--ccc-CCCCceEecCCCCCceEEeccCCCc
Confidence 5999999998 4443333222 232 22333 366 8999999988888999998765543
No 203
>KOG1963 consensus WD40 repeat protein [General function prediction only]
Probab=99.56 E-value=1.7e-12 Score=116.71 Aligned_cols=116 Identities=19% Similarity=0.257 Sum_probs=95.8
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC--C--eeEEEecCCCCCCeEEEEEecCCCEEEEEeCC
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT--G--EMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTN 94 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~--~--~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~d 94 (340)
+|.-.++|.++||+++ ++|+|..||.|.+|.-.. + .....+.- |...|++++|+++|.+|++||..
T Consensus 203 ~Htf~~t~~~~spn~~---------~~Aa~d~dGrI~vw~d~~~~~~~~t~t~lHW-H~~~V~~L~fS~~G~~LlSGG~E 272 (792)
T KOG1963|consen 203 HHTFNITCVALSPNER---------YLAAGDSDGRILVWRDFGSSDDSETCTLLHW-HHDEVNSLSFSSDGAYLLSGGRE 272 (792)
T ss_pred hhcccceeEEeccccc---------eEEEeccCCcEEEEeccccccccccceEEEe-cccccceeEEecCCceEeecccc
Confidence 6777799999999999 999999999999997433 1 13345566 88899999999999999999999
Q ss_pred CcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE--ecCcEEEEECCCC
Q 036605 95 GMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL--ASSEVRILSLENG 145 (340)
Q Consensus 95 g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~--~~~~i~i~d~~~~ 145 (340)
|.+.+|.+.+++ .+-+..-.++|..+.++||+.+.+. +|+.|.+....+.
T Consensus 273 ~VLv~Wq~~T~~-kqfLPRLgs~I~~i~vS~ds~~~sl~~~DNqI~li~~~dl 324 (792)
T KOG1963|consen 273 GVLVLWQLETGK-KQFLPRLGSPILHIVVSPDSDLYSLVLEDNQIHLIKASDL 324 (792)
T ss_pred eEEEEEeecCCC-cccccccCCeeEEEEEcCCCCeEEEEecCceEEEEeccch
Confidence 999999999988 4556667789999999999987754 6777777765443
No 204
>KOG0322 consensus G-protein beta subunit-like protein GNB1L, contains WD repeats [General function prediction only]
Probab=99.56 E-value=2.2e-13 Score=106.19 Aligned_cols=213 Identities=13% Similarity=0.076 Sum_probs=149.9
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
.|.+.|+|+.|-.+++ |.+|...|.|.+|++.+.+.+..+...|...|+.+.--|+ ..|.+-+.|+.+.
T Consensus 12 p~~~~v~s~~fqa~~r----------L~sg~~~G~V~~w~lqt~r~~~~~r~~g~~~it~lq~~p~-d~l~tqgRd~~L~ 80 (323)
T KOG0322|consen 12 PHSSSVTSVLFQANER----------LMSGLSVGIVKMWVLQTERDLPLIRLFGRLFITNLQSIPN-DSLDTQGRDPLLI 80 (323)
T ss_pred cccchheehhhccchh----------hhcccccceEEEEEeecCccchhhhhhccceeeceeecCC-cchhhcCCCceEE
Confidence 6788999999988777 9999999999999999998887777547888999988876 5678889999999
Q ss_pred EEeCCCCeEEEE------------e---------------e--------------------------cCCCCeeEEEEc-
Q 036605 99 EMKSEMGEVIRE------------F---------------K--------------------------ASEKPISSSAFL- 124 (340)
Q Consensus 99 ~wd~~~~~~~~~------------~---------------~--------------------------~~~~~i~~l~~~- 124 (340)
+|++.-+..+.. + . ...+.+.+..+.
T Consensus 81 lw~ia~s~~i~i~Si~~nslgFCrfSl~~~~k~~eqll~yp~rgsde~h~~D~g~~tqv~i~dd~~~~Klgsvmc~~~~~ 160 (323)
T KOG0322|consen 81 LWTIAYSAFISIHSIVVNSLGFCRFSLVKKPKNSEQLLEYPSRGSDETHKQDGGDTTQVQIADDSERSKLGSVMCQDKDH 160 (323)
T ss_pred EEEccCcceEEEeeeeccccccccceeccCCCcchhheecCCcccchhhhhccCccceeEccCchhccccCceeeeeccc
Confidence 999865321100 0 0 001112222211
Q ss_pred cCCC-EEEEecC---cEEEEECCCCcee----------EEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCC
Q 036605 125 CEEK-IFALASS---EVRILSLENGEEV----------LKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSK 190 (340)
Q Consensus 125 ~~~~-~l~~~~~---~i~i~d~~~~~~~----------~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~ 190 (340)
.++. .++.++. .+.+||+.++..+ .....|.++|.++.|.+.-..=++++. +..+..|.++..++
T Consensus 161 ~c~s~~lllaGyEsghvv~wd~S~~~~~~~~~~~~kv~~~~ash~qpvlsldyas~~~rGisgga-~dkl~~~Sl~~s~g 239 (323)
T KOG0322|consen 161 ACGSTFLLLAGYESGHVVIWDLSTGDKIIQLPQSSKVESPNASHKQPVLSLDYASSCDRGISGGA-DDKLVMYSLNHSTG 239 (323)
T ss_pred cccceEEEEEeccCCeEEEEEccCCceeeccccccccccchhhccCcceeeeechhhcCCcCCCc-cccceeeeeccccC
Confidence 1233 3333433 3999999998443 333568899999999876555567666 77888999965555
Q ss_pred CccCCceeeecCCCee-eeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCCce
Q 036605 191 TVNKGPALSMRHSPVA-IDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNPAK 248 (340)
Q Consensus 191 ~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p~~ 248 (340)
.........+.++... ..+ .||++.+++++.||+|+||+.++...+..++-++
T Consensus 240 slq~~~e~~lknpGv~gvrI-----RpD~KIlATAGWD~RiRVyswrtl~pLAVLkyHs 293 (323)
T KOG0322|consen 240 SLQIRKEITLKNPGVSGVRI-----RPDGKILATAGWDHRIRVYSWRTLNPLAVLKYHS 293 (323)
T ss_pred cccccceEEecCCCccceEE-----ccCCcEEeecccCCcEEEEEeccCCchhhhhhhh
Confidence 5544444444554332 233 6999999999999999999999988777555543
No 205
>PRK01742 tolB translocation protein TolB; Provisional
Probab=99.54 E-value=9.3e-13 Score=117.36 Aligned_cols=175 Identities=14% Similarity=0.091 Sum_probs=123.6
Q ss_pred CCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCC---CcEEEEeCCCCeEEEEeecCCCCeeEEEEccCC
Q 036605 51 NGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTN---GMASEMKSEMGEVIREFKASEKPISSSAFLCEE 127 (340)
Q Consensus 51 dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~d---g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~ 127 (340)
+..|++||..... ...+.. |...+..++|+|||+.|+.++.+ ..|++||+.+++.... .........++|+|||
T Consensus 183 ~~~i~i~d~dg~~-~~~lt~-~~~~v~~p~wSPDG~~la~~s~~~~~~~i~i~dl~tg~~~~l-~~~~g~~~~~~wSPDG 259 (429)
T PRK01742 183 PYEVRVADYDGFN-QFIVNR-SSQPLMSPAWSPDGSKLAYVSFENKKSQLVVHDLRSGARKVV-ASFRGHNGAPAFSPDG 259 (429)
T ss_pred eEEEEEECCCCCC-ceEecc-CCCccccceEcCCCCEEEEEEecCCCcEEEEEeCCCCceEEE-ecCCCccCceeECCCC
Confidence 4689999986554 455666 78889999999999999887654 4699999988764322 2222334578999999
Q ss_pred CEEEEe---cCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecC
Q 036605 128 KIFALA---SSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRH 202 (340)
Q Consensus 128 ~~l~~~---~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~ 202 (340)
+.|+.+ ++. |++||+.++. +..+..+...+..+.|+|||+.|+.++..++...||+++...+.. ... .+
T Consensus 260 ~~La~~~~~~g~~~Iy~~d~~~~~-~~~lt~~~~~~~~~~wSpDG~~i~f~s~~~g~~~I~~~~~~~~~~-~~l----~~ 333 (429)
T PRK01742 260 SRLAFASSKDGVLNIYVMGANGGT-PSQLTSGAGNNTEPSWSPDGQSILFTSDRSGSPQVYRMSASGGGA-SLV----GG 333 (429)
T ss_pred CEEEEEEecCCcEEEEEEECCCCC-eEeeccCCCCcCCEEECCCCCEEEEEECCCCCceEEEEECCCCCe-EEe----cC
Confidence 988763 232 6777887664 455666777788999999999888777667889999885433321 111 22
Q ss_pred CCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCc
Q 036605 203 SPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQ 240 (340)
Q Consensus 203 ~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~ 240 (340)
.. .. ..| +|+|.+++.++.++ +.+||+.++..
T Consensus 334 ~~--~~--~~~-SpDG~~ia~~~~~~-i~~~Dl~~g~~ 365 (429)
T PRK01742 334 RG--YS--AQI-SADGKTLVMINGDN-VVKQDLTSGST 365 (429)
T ss_pred CC--CC--ccC-CCCCCEEEEEcCCC-EEEEECCCCCe
Confidence 21 11 245 89999998888766 67799877653
No 206
>PF02239 Cytochrom_D1: Cytochrome D1 heme domain; PDB: 1NNO_B 1HZU_A 1N15_B 1N50_A 1GJQ_A 1BL9_B 1NIR_B 1N90_B 1HZV_A 1AOQ_A ....
Probab=99.54 E-value=7.3e-12 Score=108.38 Aligned_cols=170 Identities=14% Similarity=0.169 Sum_probs=119.3
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
|.|..+.+.+.++. ........+.|+||++ ++++.+.||.|.++|+.+++.+.++.. .....+++
T Consensus 20 viD~~t~~~~~~i~----~~~~~h~~~~~s~Dgr---------~~yv~~rdg~vsviD~~~~~~v~~i~~--G~~~~~i~ 84 (369)
T PF02239_consen 20 VIDGATNKVVARIP----TGGAPHAGLKFSPDGR---------YLYVANRDGTVSVIDLATGKVVATIKV--GGNPRGIA 84 (369)
T ss_dssp EEETTT-SEEEEEE-----STTEEEEEE-TT-SS---------EEEEEETTSEEEEEETTSSSEEEEEE---SSEEEEEE
T ss_pred EEECCCCeEEEEEc----CCCCceeEEEecCCCC---------EEEEEcCCCeEEEEECCcccEEEEEec--CCCcceEE
Confidence 35777888888887 2223345578999999 899999999999999999999988874 34578999
Q ss_pred EecCCCEEEEEe-CCCcEEEEeCCCCeEEEEeecC-------CCCeeEEEEccCCCEEEEe---cCcEEEEECCCCceeE
Q 036605 81 FAKKGRSLHVVG-TNGMASEMKSEMGEVIREFKAS-------EKPISSSAFLCEEKIFALA---SSEVRILSLENGEEVL 149 (340)
Q Consensus 81 ~~~~~~~l~s~~-~dg~i~~wd~~~~~~~~~~~~~-------~~~i~~l~~~~~~~~l~~~---~~~i~i~d~~~~~~~~ 149 (340)
+++||++++++. ..+.+.++|.++.+++..+... ...+..+..+|....++.. .+.|.+.|....+.+.
T Consensus 85 ~s~DG~~~~v~n~~~~~v~v~D~~tle~v~~I~~~~~~~~~~~~Rv~aIv~s~~~~~fVv~lkd~~~I~vVdy~d~~~~~ 164 (369)
T PF02239_consen 85 VSPDGKYVYVANYEPGTVSVIDAETLEPVKTIPTGGMPVDGPESRVAAIVASPGRPEFVVNLKDTGEIWVVDYSDPKNLK 164 (369)
T ss_dssp E--TTTEEEEEEEETTEEEEEETTT--EEEEEE--EE-TTTS---EEEEEE-SSSSEEEEEETTTTEEEEEETTTSSCEE
T ss_pred EcCCCCEEEEEecCCCceeEeccccccceeecccccccccccCCCceeEEecCCCCEEEEEEccCCeEEEEEeccccccc
Confidence 999999998776 5799999999999988876532 3457788888888855543 2348888987765442
Q ss_pred -EeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 150 -KFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 150 -~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
.............|+|+++|++.+....+.|.++|.
T Consensus 165 ~~~i~~g~~~~D~~~dpdgry~~va~~~sn~i~viD~ 201 (369)
T PF02239_consen 165 VTTIKVGRFPHDGGFDPDGRYFLVAANGSNKIAVIDT 201 (369)
T ss_dssp EEEEE--TTEEEEEE-TTSSEEEEEEGGGTEEEEEET
T ss_pred eeeecccccccccccCcccceeeecccccceeEEEee
Confidence 233334567889999999999888777888888887
No 207
>KOG1517 consensus Guanine nucleotide binding protein MIP1 [Cell cycle control, cell division, chromosome partitioning]
Probab=99.53 E-value=2.2e-12 Score=118.14 Aligned_cols=232 Identities=15% Similarity=0.095 Sum_probs=152.9
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEcc-----CCeeEEEecC-----
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVL-----TGEMKWKSTG----- 70 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~-----~~~~~~~~~~----- 70 (340)
|||.+.++++..|... .-....|+.|.+-.... ..++.+|+.||.|+||+-- +.+++..+.+
T Consensus 1090 vwd~e~~~~l~~F~n~-~~~~t~Vs~l~liNe~D-------~aLlLtas~dGvIRIwk~y~~~~~~~eLVTaw~~Ls~~~ 1161 (1387)
T KOG1517|consen 1090 VWDWEKGRLLNGFDNG-AFPDTRVSDLELINEQD-------DALLLTASSDGVIRIWKDYADKWKKPELVTAWSSLSDQL 1161 (1387)
T ss_pred EEecccCceeccccCC-CCCCCccceeeeecccc-------hhheeeeccCceEEEecccccccCCceeEEeeccccccC
Confidence 6899999988777633 23457899999965442 2289999999999999732 2233333322
Q ss_pred -CCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeec-CCCCeeEEEEcc-CCCEEEE--ecCcEEEEECCCC
Q 036605 71 -RHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKA-SEKPISSSAFLC-EEKIFAL--ASSEVRILSLENG 145 (340)
Q Consensus 71 -~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~-~~~~i~~l~~~~-~~~~l~~--~~~~i~i~d~~~~ 145 (340)
+-.+.-.-+.|.....+|+++|.-..|++||...-..+..+.. ....++++.-+. .|..+++ +||.|++||.+..
T Consensus 1162 ~~~r~~~~v~dWqQ~~G~Ll~tGd~r~IRIWDa~~E~~~~diP~~s~t~vTaLS~~~~~gn~i~AGfaDGsvRvyD~R~a 1241 (1387)
T KOG1517|consen 1162 PGARGTGLVVDWQQQSGHLLVTGDVRSIRIWDAHKEQVVADIPYGSSTLVTALSADLVHGNIIAAGFADGSVRVYDRRMA 1241 (1387)
T ss_pred ccCCCCCeeeehhhhCCeEEecCCeeEEEEEecccceeEeecccCCCccceeecccccCCceEEEeecCCceEEeecccC
Confidence 0111224567877677788777788999999987776666543 344566665443 3577766 6777999998765
Q ss_pred c---eeEEeecCCCC--eEEEEECCCCCE-EEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCC
Q 036605 146 E---EVLKFSDDVGP--LQYVSASDGAKI-IITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGT 219 (340)
Q Consensus 146 ~---~~~~~~~~~~~--v~~~~~s~~~~~-l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 219 (340)
. .+..++.|... |..+.+.+.|-. |++++. +|.|++||+|.+..+.........+... ++.+...++...
T Consensus 1242 ~~ds~v~~~R~h~~~~~Iv~~slq~~G~~elvSgs~-~G~I~~~DlR~~~~e~~~~iv~~~~yGs---~lTal~VH~hap 1317 (1387)
T KOG1517|consen 1242 PPDSLVCVYREHNDVEPIVHLSLQRQGLGELVSGSQ-DGDIQLLDLRMSSKETFLTIVAHWEYGS---ALTALTVHEHAP 1317 (1387)
T ss_pred CccccceeecccCCcccceeEEeecCCCcceeeecc-CCeEEEEecccCcccccceeeeccccCc---cceeeeeccCCC
Confidence 3 35666778766 999999887655 888777 9999999998654333222221111111 111222277778
Q ss_pred EEEEEeCCCcEEEEECCCCCccCCCCC
Q 036605 220 VILAVAESGVAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 220 ~l~~~s~dg~i~vwd~~~~~~~~~~~p 246 (340)
.+++|+. +.|.||++... ++..+++
T Consensus 1318 iiAsGs~-q~ikIy~~~G~-~l~~~k~ 1342 (1387)
T KOG1517|consen 1318 IIASGSA-QLIKIYSLSGE-QLNIIKY 1342 (1387)
T ss_pred eeeecCc-ceEEEEecChh-hhccccc
Confidence 8999988 99999998753 3333443
No 208
>PRK00178 tolB translocation protein TolB; Provisional
Probab=99.52 E-value=1.1e-11 Score=110.88 Aligned_cols=195 Identities=12% Similarity=0.104 Sum_probs=126.2
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCC---CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEE-EeCC
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSN---GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHV-VGTN 94 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~d---g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s-~~~d 94 (340)
.+...+....|+|||+ .|+..+.+ ..|++||+.+++.. .+.. ..+.+...+|+|||+.|+. .+.+
T Consensus 196 ~~~~~~~~p~wSpDG~---------~la~~s~~~~~~~l~~~~l~~g~~~-~l~~-~~g~~~~~~~SpDG~~la~~~~~~ 264 (430)
T PRK00178 196 QSREPILSPRWSPDGK---------RIAYVSFEQKRPRIFVQNLDTGRRE-QITN-FEGLNGAPAWSPDGSKLAFVLSKD 264 (430)
T ss_pred cCCCceeeeeECCCCC---------EEEEEEcCCCCCEEEEEECCCCCEE-EccC-CCCCcCCeEECCCCCEEEEEEccC
Confidence 3556788999999997 67665433 36999999988644 3433 4455667999999998764 4444
Q ss_pred C--cEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec-C----cEEEEECCCCceeEEeecCCCCeEEEEECCCC
Q 036605 95 G--MASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALAS-S----EVRILSLENGEEVLKFSDDVGPLQYVSASDGA 167 (340)
Q Consensus 95 g--~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~-~----~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~ 167 (340)
| .|.+||+.++... .+..+........|+|||+.++..+ . .|+++|+.+++.. .+...........|+|+|
T Consensus 265 g~~~Iy~~d~~~~~~~-~lt~~~~~~~~~~~spDg~~i~f~s~~~g~~~iy~~d~~~g~~~-~lt~~~~~~~~~~~Spdg 342 (430)
T PRK00178 265 GNPEIYVMDLASRQLS-RVTNHPAIDTEPFWGKDGRTLYFTSDRGGKPQIYKVNVNGGRAE-RVTFVGNYNARPRLSADG 342 (430)
T ss_pred CCceEEEEECCCCCeE-EcccCCCCcCCeEECCCCCEEEEEECCCCCceEEEEECCCCCEE-EeecCCCCccceEECCCC
Confidence 4 6888999887654 4444555566788999999876532 2 3888998887643 332222334467899999
Q ss_pred CEEEEEEcCCC--eEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCC---CcEEEEECC
Q 036605 168 KIIITAGYGEK--HLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAES---GVAYSWDLK 236 (340)
Q Consensus 168 ~~l~s~~~~d~--~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~d---g~i~vwd~~ 236 (340)
++|+.....++ .|.+||+ .+++. ..+. ...... ...| +|+|..++..+.+ +.|+++++.
T Consensus 343 ~~i~~~~~~~~~~~l~~~dl--~tg~~-~~lt----~~~~~~--~p~~-spdg~~i~~~~~~~g~~~l~~~~~~ 406 (430)
T PRK00178 343 KTLVMVHRQDGNFHVAAQDL--QRGSV-RILT----DTSLDE--SPSV-APNGTMLIYATRQQGRGVLMLVSIN 406 (430)
T ss_pred CEEEEEEccCCceEEEEEEC--CCCCE-EEcc----CCCCCC--CceE-CCCCCEEEEEEecCCceEEEEEECC
Confidence 99988775444 4667776 44332 1111 111111 1244 8899988877654 346666664
No 209
>KOG1240 consensus Protein kinase containing WD40 repeats [Signal transduction mechanisms]
Probab=99.52 E-value=4.6e-12 Score=117.72 Aligned_cols=217 Identities=12% Similarity=0.150 Sum_probs=141.5
Q ss_pred CCceeeeeeCCCCCCCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCe-------eEEEecCCCCCCeE
Q 036605 6 DGSLLAEWKQPDGEPVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGE-------MKWKSTGRHPGGLA 77 (340)
Q Consensus 6 ~g~~~~~~~~~~~~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~-------~~~~~~~~h~~~v~ 77 (340)
.|.+++.+. .|+..|..++.++.. . ++++|+.||+|++||...-. ...++.. ....+.
T Consensus 1037 ~G~lVAhL~----Ehs~~v~k~a~s~~~~s---------~FvsgS~DGtVKvW~~~k~~~~~~s~rS~ltys~-~~sr~~ 1102 (1431)
T KOG1240|consen 1037 RGILVAHLH----EHSSAVIKLAVSSEHTS---------LFVSGSDDGTVKVWNLRKLEGEGGSARSELTYSP-EGSRVE 1102 (1431)
T ss_pred cceEeehhh----hccccccceeecCCCCc---------eEEEecCCceEEEeeehhhhcCcceeeeeEEEec-cCCceE
Confidence 456666665 688888888888766 7 99999999999999976421 2223332 456889
Q ss_pred EEEEecCCCEEEEEeCCCcEEEEeCCCCeE-------EEEeecCC--CCeeEEEEccC-CC-EEEE--ecCcEEEEECCC
Q 036605 78 GLAFAKKGRSLHVVGTNGMASEMKSEMGEV-------IREFKASE--KPISSSAFLCE-EK-IFAL--ASSEVRILSLEN 144 (340)
Q Consensus 78 ~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~-------~~~~~~~~--~~i~~l~~~~~-~~-~l~~--~~~~i~i~d~~~ 144 (340)
++.+.+.+..++.++.||.|.+.++.-.+. ......+. ..+..-++... +. .++. --+.|..||+++
T Consensus 1103 ~vt~~~~~~~~Av~t~DG~v~~~~id~~~~~~~~~~~~ri~n~~~~g~vv~m~a~~~~~~S~~lvy~T~~~~iv~~D~r~ 1182 (1431)
T KOG1240|consen 1103 KVTMCGNGDQFAVSTKDGSVRVLRIDHYNVSKRVATQVRIPNLKKDGVVVSMHAFTAIVQSHVLVYATDLSRIVSWDTRM 1182 (1431)
T ss_pred EEEeccCCCeEEEEcCCCeEEEEEccccccccceeeeeecccccCCCceEEeecccccccceeEEEEEeccceEEecchh
Confidence 999999999999999999999999875211 11111111 22333333322 22 2322 233499999988
Q ss_pred CceeEEe--ecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEE
Q 036605 145 GEEVLKF--SDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVIL 222 (340)
Q Consensus 145 ~~~~~~~--~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~ 222 (340)
......+ ....+.|++++.+|.+.+++.|.. .|.+.+||+|- +..+. .+...+...+..+.++...+.....+
T Consensus 1183 ~~~~w~lk~~~~hG~vTSi~idp~~~WlviGts-~G~l~lWDLRF--~~~i~--sw~~P~~~~i~~v~~~~~~~~~S~~v 1257 (1431)
T KOG1240|consen 1183 RHDAWRLKNQLRHGLVTSIVIDPWCNWLVIGTS-RGQLVLWDLRF--RVPIL--SWEHPARAPIRHVWLCPTYPQESVSV 1257 (1431)
T ss_pred hhhHHhhhcCccccceeEEEecCCceEEEEecC-CceEEEEEeec--Cceee--cccCcccCCcceEEeeccCCCCceEE
Confidence 7655433 445589999999999999999777 99999999962 22222 22223333344444344344334444
Q ss_pred EEe--CCCcEEEEECCCCCcc
Q 036605 223 AVA--ESGVAYSWDLKTVSQD 241 (340)
Q Consensus 223 ~~s--~dg~i~vwd~~~~~~~ 241 (340)
+++ ..+.|.+|++.++...
T Consensus 1258 s~~~~~~nevs~wn~~~g~~~ 1278 (1431)
T KOG1240|consen 1258 SAGSSSNNEVSTWNMETGLRQ 1278 (1431)
T ss_pred EecccCCCceeeeecccCcce
Confidence 444 5678999999987443
No 210
>KOG1963 consensus WD40 repeat protein [General function prediction only]
Probab=99.52 E-value=2.7e-12 Score=115.35 Aligned_cols=227 Identities=15% Similarity=0.141 Sum_probs=161.4
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEe------------
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKS------------ 68 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~------------ 68 (340)
||-+.+|+++..+. .|..+++.+.+.|...+ ..++.+++.+|.|++||...+.++..+
T Consensus 41 VyS~~Tg~~i~~l~----~~~a~l~s~~~~~~~~~------~~~~~~~sl~G~I~vwd~~~~~Llkt~~~~~~v~~~~~~ 110 (792)
T KOG1963|consen 41 VYSTATGECITSLE----DHTAPLTSVIVLPSSEN------ANYLIVCSLDGTIRVWDWSDGELLKTFDNNLPVHALVYK 110 (792)
T ss_pred EEecchHhhhhhcc----cccCccceeeecCCCcc------ceEEEEEecCccEEEecCCCcEEEEEEecCCceeEEEec
Confidence 45667777777665 78889999999776531 237889999999999997666544332
Q ss_pred --------------------------------------------------------------------------------
Q 036605 69 -------------------------------------------------------------------------------- 68 (340)
Q Consensus 69 -------------------------------------------------------------------------------- 68 (340)
T Consensus 111 ~~~a~~s~~~~~s~~~~~~~~~~s~~~~~q~~~~~~~t~~~~~~d~~~~~~~~~~I~~~~~ge~~~i~~~~~~~~~~v~~ 190 (792)
T KOG1963|consen 111 PAQADISANVYVSVEDYSILTTFSKKLSKQSSRFVLATFDSAKGDFLKEHQEPKSIVDNNSGEFKGIVHMCKIHIYFVPK 190 (792)
T ss_pred hhHhCccceeEeecccceeeeecccccccceeeeEeeeccccchhhhhhhcCCccEEEcCCceEEEEEEeeeEEEEEecc
Confidence
Q ss_pred ----------cCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCC--C--eEEEEeecCCCCeeEEEEccCCCEEEEec
Q 036605 69 ----------TGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEM--G--EVIREFKASEKPISSSAFLCEEKIFALAS 134 (340)
Q Consensus 69 ----------~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~--~--~~~~~~~~~~~~i~~l~~~~~~~~l~~~~ 134 (340)
...|.-.+++.+++|.+++++++..||.|.+|.--. + .....+.-|...|.+++|+++|.+|++|+
T Consensus 191 ~~~~~~~~~~~~~Htf~~t~~~~spn~~~~Aa~d~dGrI~vw~d~~~~~~~~t~t~lHWH~~~V~~L~fS~~G~~LlSGG 270 (792)
T KOG1963|consen 191 HTKHTSSRDITVHHTFNITCVALSPNERYLAAGDSDGRILVWRDFGSSDDSETCTLLHWHHDEVNSLSFSSDGAYLLSGG 270 (792)
T ss_pred cceeeccchhhhhhcccceeEEeccccceEEEeccCCcEEEEeccccccccccceEEEecccccceeEEecCCceEeecc
Confidence 002455678999999999999999999999996432 1 23345778899999999999999999999
Q ss_pred Cc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEcc-CCCCCccCCceee-----ecCCCee
Q 036605 135 SE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCD-ISSKTVNKGPALS-----MRHSPVA 206 (340)
Q Consensus 135 ~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~-~~~~~~~~~~~~~-----~~~~~~~ 206 (340)
.. +.+|.+.+++ ..-++--.++|..+.++||+.+...... |+.|.+-... +..+..+..+... -......
T Consensus 271 ~E~VLv~Wq~~T~~-kqfLPRLgs~I~~i~vS~ds~~~sl~~~-DNqI~li~~~dl~~k~tIsgi~~~~~~~k~~~~~l~ 348 (792)
T KOG1963|consen 271 REGVLVLWQLETGK-KQFLPRLGSPILHIVVSPDSDLYSLVLE-DNQIHLIKASDLEIKSTISGIKPPTPSTKTRPQSLT 348 (792)
T ss_pred cceEEEEEeecCCC-cccccccCCeeEEEEEcCCCCeEEEEec-CceEEEEeccchhhhhhccCccCCCccccccccccc
Confidence 88 8999999987 2333555689999999999998888777 9999998761 1111111111100 0001111
Q ss_pred eeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 207 IDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 207 ~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
..+ +. .|....++-.+..|.|.+||+.+...+.
T Consensus 349 t~~--~i-dpr~~~~vln~~~g~vQ~ydl~td~~i~ 381 (792)
T KOG1963|consen 349 TGV--SI-DPRTNSLVLNGHPGHVQFYDLYTDSTIY 381 (792)
T ss_pred eeE--EE-cCCCCceeecCCCceEEEEeccccceee
Confidence 111 22 4555667778889999999998877665
No 211
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=99.51 E-value=1.5e-11 Score=109.76 Aligned_cols=194 Identities=17% Similarity=0.126 Sum_probs=127.5
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCC---CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEE-EeCC
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSN---GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHV-VGTN 94 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~d---g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s-~~~d 94 (340)
.+...+...+|+|+|+ +|+.++.. ..|++||+.+++.. .+.. +.+.+.+++|+|||+.|+. .+.+
T Consensus 187 ~~~~~~~~p~~Spdg~---------~la~~~~~~~~~~i~v~d~~~g~~~-~~~~-~~~~~~~~~~spDg~~l~~~~~~~ 255 (417)
T TIGR02800 187 RSREPILSPAWSPDGQ---------KLAYVSFESGKPEIYVQDLATGQRE-KVAS-FPGMNGAPAFSPDGSKLAVSLSKD 255 (417)
T ss_pred cCCCceecccCCCCCC---------EEEEEEcCCCCcEEEEEECCCCCEE-Eeec-CCCCccceEECCCCCEEEEEECCC
Confidence 3445688899999998 77776543 47999999988644 3333 5566778999999997764 4444
Q ss_pred --CcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec-C----cEEEEECCCCceeEEeecCCCCeEEEEECCCC
Q 036605 95 --GMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALAS-S----EVRILSLENGEEVLKFSDDVGPLQYVSASDGA 167 (340)
Q Consensus 95 --g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~-~----~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~ 167 (340)
..|++||+.++... .+..+........|+|+|+.++..+ . .|+++|+.+++. ..+..+...+..+.|+|+|
T Consensus 256 ~~~~i~~~d~~~~~~~-~l~~~~~~~~~~~~s~dg~~l~~~s~~~g~~~iy~~d~~~~~~-~~l~~~~~~~~~~~~spdg 333 (417)
T TIGR02800 256 GNPDIYVMDLDGKQLT-RLTNGPGIDTEPSWSPDGKSIAFTSDRGGSPQIYMMDADGGEV-RRLTFRGGYNASPSWSPDG 333 (417)
T ss_pred CCccEEEEECCCCCEE-ECCCCCCCCCCEEECCCCCEEEEEECCCCCceEEEEECCCCCE-EEeecCCCCccCeEECCCC
Confidence 35899999887643 3444444455778999999876532 2 388999887753 4454455667788999999
Q ss_pred CEEEEEEcCCC--eEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCC---cEEEEEC
Q 036605 168 KIIITAGYGEK--HLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESG---VAYSWDL 235 (340)
Q Consensus 168 ~~l~s~~~~d~--~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg---~i~vwd~ 235 (340)
++++.+....+ .|.+||+ ..+... .+. .. .... ...| ++++.+|+..+.++ .+++.+.
T Consensus 334 ~~i~~~~~~~~~~~i~~~d~--~~~~~~-~l~---~~-~~~~--~p~~-spdg~~l~~~~~~~~~~~l~~~~~ 396 (417)
T TIGR02800 334 DLIAFVHREGGGFNIAVMDL--DGGGER-VLT---DT-GLDE--SPSF-APNGRMILYATTRGGRGVLGLVST 396 (417)
T ss_pred CEEEEEEccCCceEEEEEeC--CCCCeE-Ecc---CC-CCCC--CceE-CCCCCEEEEEEeCCCcEEEEEEEC
Confidence 99998776322 6777776 333221 111 11 1111 1134 78998888877764 3444443
No 212
>PRK04792 tolB translocation protein TolB; Provisional
Probab=99.51 E-value=1.3e-11 Score=110.22 Aligned_cols=196 Identities=15% Similarity=0.166 Sum_probs=123.6
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcC-CC--cEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEE-EeCCC
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTS-NG--DILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHV-VGTNG 95 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~-dg--~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s-~~~dg 95 (340)
....+.+..|||||+ .|+..+. ++ .|++||+.+++.. .+.. ..+.....+|+|||+.|+. .+.+|
T Consensus 216 ~~~~~~~p~wSPDG~---------~La~~s~~~g~~~L~~~dl~tg~~~-~lt~-~~g~~~~~~wSPDG~~La~~~~~~g 284 (448)
T PRK04792 216 SPEPLMSPAWSPDGR---------KLAYVSFENRKAEIFVQDIYTQVRE-KVTS-FPGINGAPRFSPDGKKLALVLSKDG 284 (448)
T ss_pred CCCcccCceECCCCC---------EEEEEEecCCCcEEEEEECCCCCeE-EecC-CCCCcCCeeECCCCCEEEEEEeCCC
Confidence 345678899999997 6766543 33 5889999888643 2332 3334557899999997765 45566
Q ss_pred c--EEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec-C----cEEEEECCCCceeEEeecCCCCeEEEEECCCCC
Q 036605 96 M--ASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALAS-S----EVRILSLENGEEVLKFSDDVGPLQYVSASDGAK 168 (340)
Q Consensus 96 ~--i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~-~----~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~ 168 (340)
. |+++|+.+++.. .+..+.......+|+|||+.++... . +|+++|+.+++.. .+...........|+|||+
T Consensus 285 ~~~Iy~~dl~tg~~~-~lt~~~~~~~~p~wSpDG~~I~f~s~~~g~~~Iy~~dl~~g~~~-~Lt~~g~~~~~~~~SpDG~ 362 (448)
T PRK04792 285 QPEIYVVDIATKALT-RITRHRAIDTEPSWHPDGKSLIFTSERGGKPQIYRVNLASGKVS-RLTFEGEQNLGGSITPDGR 362 (448)
T ss_pred CeEEEEEECCCCCeE-ECccCCCCccceEECCCCCEEEEEECCCCCceEEEEECCCCCEE-EEecCCCCCcCeeECCCCC
Confidence 4 888899887653 4444555567889999999886532 1 2888899887643 3322222334578999999
Q ss_pred EEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCC-Cc--EEEEECC
Q 036605 169 IIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAES-GV--AYSWDLK 236 (340)
Q Consensus 169 ~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~d-g~--i~vwd~~ 236 (340)
+|+..+..++...||-++..+++.. .+. .. .. +....| +|+|..|+..+.+ |. +++++..
T Consensus 363 ~l~~~~~~~g~~~I~~~dl~~g~~~-~lt---~~-~~--d~~ps~-spdG~~I~~~~~~~g~~~l~~~~~~ 425 (448)
T PRK04792 363 SMIMVNRTNGKFNIARQDLETGAMQ-VLT---ST-RL--DESPSV-APNGTMVIYSTTYQGKQVLAAVSID 425 (448)
T ss_pred EEEEEEecCCceEEEEEECCCCCeE-Ecc---CC-CC--CCCceE-CCCCCEEEEEEecCCceEEEEEECC
Confidence 9988776556555654433444321 111 11 11 111144 8899888766544 33 6666763
No 213
>KOG2139 consensus WD40 repeat protein [General function prediction only]
Probab=99.50 E-value=2.9e-12 Score=104.30 Aligned_cols=197 Identities=14% Similarity=0.126 Sum_probs=135.1
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCC-EEEEEeCCCcEEEE
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGR-SLHVVGTNGMASEM 100 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~-~l~s~~~dg~i~~w 100 (340)
..+..++|++.-- -+|++..|-.|++||-.. .....++...+..|+|++|-|.+. .|+.|+. +-|.+|
T Consensus 99 ~dlr~~aWhqH~~---------~fava~nddvVriy~kss-t~pt~Lks~sQrnvtclawRPlsaselavgCr-~gIciW 167 (445)
T KOG2139|consen 99 IDLRGVAWHQHII---------AFAVATNDDVVRIYDKSS-TCPTKLKSVSQRNVTCLAWRPLSASELAVGCR-AGICIW 167 (445)
T ss_pred cceeeEeechhhh---------hhhhhccCcEEEEeccCC-CCCceecchhhcceeEEEeccCCcceeeeeec-ceeEEE
Confidence 4567899998654 588999999999999766 555566654567899999999654 5555554 468899
Q ss_pred eCCCC----eEE--------EEee-cCCCCeeEEEEccCCCEEEEe---cCcEEEEECCCCceeEEeecCCCCeEEEEEC
Q 036605 101 KSEMG----EVI--------REFK-ASEKPISSSAFLCEEKIFALA---SSEVRILSLENGEEVLKFSDDVGPLQYVSAS 164 (340)
Q Consensus 101 d~~~~----~~~--------~~~~-~~~~~i~~l~~~~~~~~l~~~---~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s 164 (340)
..... ..+ ..++ ....+|++++|.+||..++++ +..|.|||..++..+.-.....+.+.-+.||
T Consensus 168 ~~s~tln~~r~~~~~s~~~~qvl~~pgh~pVtsmqwn~dgt~l~tAS~gsssi~iWdpdtg~~~pL~~~glgg~slLkwS 247 (445)
T KOG2139|consen 168 SDSRTLNANRNIRMMSTHHLQVLQDPGHNPVTSMQWNEDGTILVTASFGSSSIMIWDPDTGQKIPLIPKGLGGFSLLKWS 247 (445)
T ss_pred EcCcccccccccccccccchhheeCCCCceeeEEEEcCCCCEEeecccCcceEEEEcCCCCCcccccccCCCceeeEEEc
Confidence 75421 111 1111 123689999999999999884 4459999999987664444455788899999
Q ss_pred CCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCC
Q 036605 165 DGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVS 239 (340)
Q Consensus 165 ~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~ 239 (340)
||+.+|+++.. |+..++|+.. .+... .... -.+..+... +| +|+|.+|+.+... .-.+|.+.-..
T Consensus 248 Pdgd~lfaAt~-davfrlw~e~-q~wt~-erw~---lgsgrvqta--cW-spcGsfLLf~~sg-sp~lysl~f~~ 312 (445)
T KOG2139|consen 248 PDGDVLFAATC-DAVFRLWQEN-QSWTK-ERWI---LGSGRVQTA--CW-SPCGSFLLFACSG-SPRLYSLTFDG 312 (445)
T ss_pred CCCCEEEEecc-cceeeeehhc-cccee-ccee---ccCCceeee--ee-cCCCCEEEEEEcC-CceEEEEeecC
Confidence 99999999888 9999999752 11111 1111 112233333 67 8999988776644 35666665433
No 214
>KOG1524 consensus WD40 repeat-containing protein CHE-2 [General function prediction only]
Probab=99.50 E-value=1.7e-13 Score=116.76 Aligned_cols=136 Identities=13% Similarity=0.123 Sum_probs=107.3
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcE
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMA 97 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i 97 (340)
..|.+.+.|-.|+|+|. -|++++.||.|++|.- +|-+..++.. ...+|+|++|.|+.+.++.|. .+.+
T Consensus 101 ~AH~~A~~~gRW~~dGt---------gLlt~GEDG~iKiWSr-sGMLRStl~Q-~~~~v~c~~W~p~S~~vl~c~-g~h~ 168 (737)
T KOG1524|consen 101 SAHAAAISSGRWSPDGA---------GLLTAGEDGVIKIWSR-SGMLRSTVVQ-NEESIRCARWAPNSNSIVFCQ-GGHI 168 (737)
T ss_pred hhhhhhhhhcccCCCCc---------eeeeecCCceEEEEec-cchHHHHHhh-cCceeEEEEECCCCCceEEec-CCeE
Confidence 37889999999999998 7999999999999984 4533334443 667999999999887766644 3467
Q ss_pred EEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCC
Q 036605 98 SEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDG 166 (340)
Q Consensus 98 ~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~ 166 (340)
.+=.+.....+..+++|.+-|.++.|++...++++++.+ .++||.. |..+..-..|..+|++++|.|+
T Consensus 169 ~IKpL~~n~k~i~WkAHDGiiL~~~W~~~s~lI~sgGED~kfKvWD~~-G~~Lf~S~~~ey~ITSva~npd 238 (737)
T KOG1524|consen 169 SIKPLAANSKIIRWRAHDGLVLSLSWSTQSNIIASGGEDFRFKIWDAQ-GANLFTSAAEEYAITSVAFNPE 238 (737)
T ss_pred EEeecccccceeEEeccCcEEEEeecCccccceeecCCceeEEeeccc-CcccccCChhccceeeeeeccc
Confidence 676676666778899999999999999999999999888 8899964 4455555566667777777666
No 215
>KOG0771 consensus Prolactin regulatory element-binding protein/Protein transport protein SEC12p [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.50 E-value=4.5e-13 Score=110.91 Aligned_cols=161 Identities=16% Similarity=0.154 Sum_probs=117.4
Q ss_pred EEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc-EEEEECCCCceeEEeec--
Q 036605 77 AGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE-VRILSLENGEEVLKFSD-- 153 (340)
Q Consensus 77 ~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~-i~i~d~~~~~~~~~~~~-- 153 (340)
.+++|+++|..|++++.||.+++|+..+...+.....|...|.++.|+|||++|++.+.+ .+||+..++..+.....
T Consensus 148 k~vaf~~~gs~latgg~dg~lRv~~~Ps~~t~l~e~~~~~eV~DL~FS~dgk~lasig~d~~~VW~~~~g~~~a~~t~~~ 227 (398)
T KOG0771|consen 148 KVVAFNGDGSKLATGGTDGTLRVWEWPSMLTILEEIAHHAEVKDLDFSPDGKFLASIGADSARVWSVNTGAALARKTPFS 227 (398)
T ss_pred eEEEEcCCCCEeeeccccceEEEEecCcchhhhhhHhhcCccccceeCCCCcEEEEecCCceEEEEeccCchhhhcCCcc
Confidence 678999999999999999999999988877777778899999999999999999985555 99999999966655432
Q ss_pred CCCCeEEEEECCCC---CE-EEEEEcCCCeEEEEEccCCCCCcc-CCceeeecC-CCeeeeeecCCCCCCCCEEEEEeCC
Q 036605 154 DVGPLQYVSASDGA---KI-IITAGYGEKHLQVWRCDISSKTVN-KGPALSMRH-SPVAIDCKNSPNGEDGTVILAVAES 227 (340)
Q Consensus 154 ~~~~v~~~~~s~~~---~~-l~s~~~~d~~i~iwd~~~~~~~~~-~~~~~~~~~-~~~~~~~~~~~~~~~~~~l~~~s~d 227 (340)
-......+.|+.|+ .+ +++.....+.|+.||+....+... ........+ ....+++ +++|++++.|+.|
T Consensus 228 k~~~~~~cRF~~d~~~~~l~laa~~~~~~~v~~~~~~~w~~~~~l~~~~~~~~~~siSsl~V-----S~dGkf~AlGT~d 302 (398)
T KOG0771|consen 228 KDEMFSSCRFSVDNAQETLRLAASQFPGGGVRLCDISLWSGSNFLRLRKKIKRFKSISSLAV-----SDDGKFLALGTMD 302 (398)
T ss_pred cchhhhhceecccCCCceEEEEEecCCCCceeEEEeeeeccccccchhhhhhccCcceeEEE-----cCCCcEEEEeccC
Confidence 23445677887766 33 333333356777777633222100 100100122 2334555 8999999999999
Q ss_pred CcEEEEECCCCCccC
Q 036605 228 GVAYSWDLKTVSQDE 242 (340)
Q Consensus 228 g~i~vwd~~~~~~~~ 242 (340)
|.|.|++....+.+.
T Consensus 303 GsVai~~~~~lq~~~ 317 (398)
T KOG0771|consen 303 GSVAIYDAKSLQRLQ 317 (398)
T ss_pred CcEEEEEeceeeeeE
Confidence 999999999877776
No 216
>KOG1310 consensus WD40 repeat protein [General function prediction only]
Probab=99.49 E-value=1.1e-13 Score=118.05 Aligned_cols=169 Identities=12% Similarity=0.162 Sum_probs=122.1
Q ss_pred EEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEe-ecCCCCeeEEEEccC--CCEEEEecCc--EEEE
Q 036605 66 WKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREF-KASEKPISSSAFLCE--EKIFALASSE--VRIL 140 (340)
Q Consensus 66 ~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~-~~~~~~i~~l~~~~~--~~~l~~~~~~--i~i~ 140 (340)
..+.+ |++.|+|+.|+.+|.+|++|++|-.+.|||....+.++.+ ++|...|.++.|-|. .++++++.++ |++|
T Consensus 44 ~eL~G-H~GCVN~LeWn~dG~lL~SGSDD~r~ivWd~~~~KllhsI~TgHtaNIFsvKFvP~tnnriv~sgAgDk~i~lf 122 (758)
T KOG1310|consen 44 AELTG-HTGCVNCLEWNADGELLASGSDDTRLIVWDPFEYKLLHSISTGHTANIFSVKFVPYTNNRIVLSGAGDKLIKLF 122 (758)
T ss_pred hhhcc-ccceecceeecCCCCEEeecCCcceEEeecchhcceeeeeecccccceeEEeeeccCCCeEEEeccCcceEEEE
Confidence 45677 9999999999999999999999999999999887777765 478889999999984 4567776665 9999
Q ss_pred ECCCC----------ceeEEeecCCCCeEEEEECCCCC-EEEEEEcCCCeEEEEEccCCCC-CccC-CceeeecCCCeee
Q 036605 141 SLENG----------EEVLKFSDDVGPLQYVSASDGAK-IIITAGYGEKHLQVWRCDISSK-TVNK-GPALSMRHSPVAI 207 (340)
Q Consensus 141 d~~~~----------~~~~~~~~~~~~v~~~~~s~~~~-~l~s~~~~d~~i~iwd~~~~~~-~~~~-~~~~~~~~~~~~~ 207 (340)
|+... +....+..|...|..++..|++. .+.+++. ||+|+-+|++.... .... .........+..+
T Consensus 123 dl~~~~~~~~d~~~~~~~~~~~cht~rVKria~~p~~PhtfwsasE-DGtirQyDiREph~c~p~~~~~~~l~ny~~~li 201 (758)
T KOG1310|consen 123 DLDSSKEGGMDHGMEETTRCWSCHTDRVKRIATAPNGPHTFWSASE-DGTIRQYDIREPHVCNPDEDCPSILVNYNPQLI 201 (758)
T ss_pred ecccccccccccCccchhhhhhhhhhhhhheecCCCCCceEEEecC-CcceeeecccCCccCCccccccHHHHHhchhhh
Confidence 99742 23355677888999999999984 5556555 99999999974321 1100 0000001111222
Q ss_pred eeecCC-CCCCCCEEEEEeCCCcEEEEECC
Q 036605 208 DCKNSP-NGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 208 ~~~~~~-~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
.+.|+. ...+..+|++|+.|-..++||.+
T Consensus 202 elk~ltisp~rp~~laVGgsdpfarLYD~R 231 (758)
T KOG1310|consen 202 ELKCLTISPSRPYYLAVGGSDPFARLYDRR 231 (758)
T ss_pred eeeeeeecCCCCceEEecCCCchhhhhhhh
Confidence 222222 24567789999999999999953
No 217
>KOG2394 consensus WD40 protein DMR-N9 [General function prediction only]
Probab=99.49 E-value=3.3e-13 Score=114.92 Aligned_cols=160 Identities=19% Similarity=0.234 Sum_probs=116.7
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecC---CCCCCeEEEEEecCCC-EEEEEeCCCcEEEEeCCC---------------
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTG---RHPGGLAGLAFAKKGR-SLHVVGTNGMASEMKSEM--------------- 104 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~---~h~~~v~~v~~~~~~~-~l~s~~~dg~i~~wd~~~--------------- 104 (340)
-|.+|-..|.|.++|....+....+.. ..+..|+|+.|-|.+. .++.+-.+|.+++||..-
T Consensus 187 dllIGf~tGqvq~idp~~~~~sklfne~r~i~ktsvT~ikWvpg~~~~Fl~a~~sGnlyly~~~~~~~~t~p~~~~~k~~ 266 (636)
T KOG2394|consen 187 DLLIGFTTGQVQLIDPINFEVSKLFNEERLINKSSVTCIKWVPGSDSLFLVAHASGNLYLYDKEIVCGATAPSYQALKDG 266 (636)
T ss_pred ceEEeeccCceEEecchhhHHHHhhhhcccccccceEEEEEEeCCCceEEEEEecCceEEeeccccccCCCCcccccCCC
Confidence 477888899999998766432221211 1346899999998544 555567889999997431
Q ss_pred -------------CeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCE
Q 036605 105 -------------GEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKI 169 (340)
Q Consensus 105 -------------~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~ 169 (340)
..++..|......|..++|+|||++||+.+.+ ++|||..+.+.+..++..-+...+++|+|||+|
T Consensus 267 ~~f~i~t~ksk~~rNPv~~w~~~~g~in~f~FS~DG~~LA~VSqDGfLRvF~fdt~eLlg~mkSYFGGLLCvcWSPDGKy 346 (636)
T KOG2394|consen 267 DQFAILTSKSKKTRNPVARWHIGEGSINEFAFSPDGKYLATVSQDGFLRIFDFDTQELLGVMKSYFGGLLCVCWSPDGKY 346 (636)
T ss_pred CeeEEeeeeccccCCccceeEeccccccceeEcCCCceEEEEecCceEEEeeccHHHHHHHHHhhccceEEEEEcCCccE
Confidence 12233344455688999999999999997666 999999998877777767788999999999999
Q ss_pred EEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeee
Q 036605 170 IITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDC 209 (340)
Q Consensus 170 l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~ 209 (340)
|++++. |..|.||.+ ..++....-. +|..++..+
T Consensus 347 IvtGGE-DDLVtVwSf--~erRVVARGq---GHkSWVs~V 380 (636)
T KOG2394|consen 347 IVTGGE-DDLVTVWSF--EERRVVARGQ---GHKSWVSVV 380 (636)
T ss_pred EEecCC-cceEEEEEe--ccceEEEecc---ccccceeeE
Confidence 999998 999999999 4444333333 565555544
No 218
>KOG2139 consensus WD40 repeat protein [General function prediction only]
Probab=99.49 E-value=7.1e-12 Score=102.07 Aligned_cols=203 Identities=13% Similarity=0.128 Sum_probs=133.9
Q ss_pred CCeEEEEeeccccccccccCceEEEEEc-CCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEE
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGT-SNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEM 100 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~-~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~w 100 (340)
..|++|.|.+||. .+++++ .|..|.|||+.++..+..... ..+.+.-+.|+||+.+|+.+.-|+..++|
T Consensus 196 ~pVtsmqwn~dgt---------~l~tAS~gsssi~iWdpdtg~~~pL~~~-glgg~slLkwSPdgd~lfaAt~davfrlw 265 (445)
T KOG2139|consen 196 NPVTSMQWNEDGT---------ILVTASFGSSSIMIWDPDTGQKIPLIPK-GLGGFSLLKWSPDGDVLFAATCDAVFRLW 265 (445)
T ss_pred ceeeEEEEcCCCC---------EEeecccCcceEEEEcCCCCCccccccc-CCCceeeEEEcCCCCEEEEecccceeeee
Confidence 7899999999997 677766 568999999999875543323 56789999999999999999999999999
Q ss_pred eCCCCeEEEEeecCCCCeeEEEEccCCCEEE-EecCcEEEEECCCCc------------e---eEEe------ec---CC
Q 036605 101 KSEMGEVIREFKASEKPISSSAFLCEEKIFA-LASSEVRILSLENGE------------E---VLKF------SD---DV 155 (340)
Q Consensus 101 d~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~-~~~~~i~i~d~~~~~------------~---~~~~------~~---~~ 155 (340)
..........+....+.|...+|+|+|++|+ +..+.-.+|.+.-.. . +..+ .+ ..
T Consensus 266 ~e~q~wt~erw~lgsgrvqtacWspcGsfLLf~~sgsp~lysl~f~~~~~~~~~~~~~k~~lliaDL~e~ti~ag~~l~c 345 (445)
T KOG2139|consen 266 QENQSWTKERWILGSGRVQTACWSPCGSFLLFACSGSPRLYSLTFDGEDSVFLRPQSIKRVLLIADLQEVTICAGQRLCC 345 (445)
T ss_pred hhcccceecceeccCCceeeeeecCCCCEEEEEEcCCceEEEEeecCCCccccCcccceeeeeeccchhhhhhcCccccc
Confidence 6554444445555666899999999999874 455555555442110 0 0111 01 13
Q ss_pred CCeEEEEECCCCCEEEEEEcCC-------CeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCC
Q 036605 156 GPLQYVSASDGAKIIITAGYGE-------KHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESG 228 (340)
Q Consensus 156 ~~v~~~~~s~~~~~l~s~~~~d-------~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg 228 (340)
+.+.+++|.|.|.|+++.-.+. ..|.+||.+....-......+.-+..+..+.+ .+...++.+|..+=+.|
T Consensus 346 geaq~lawDpsGeyLav~fKg~~~v~~~k~~i~~fdtr~sp~vels~cg~i~ge~P~~IsF--~pl~n~g~lLsiaWsTG 423 (445)
T KOG2139|consen 346 GEAQCLAWDPSGEYLAVIFKGQSFVLLCKLHISRFDTRKSPPVELSYCGMIGGEYPAYISF--GPLKNEGRLLSIAWSTG 423 (445)
T ss_pred CccceeeECCCCCEEEEEEcCCchhhhhhhhhhhhcccccCceEEEecccccCCCCceEEe--eecccCCcEEEEEeccC
Confidence 6789999999999999865532 23566665311100000001111233455555 33235667777777788
Q ss_pred cEEEEECC
Q 036605 229 VAYSWDLK 236 (340)
Q Consensus 229 ~i~vwd~~ 236 (340)
.+.-|++.
T Consensus 424 riq~ypl~ 431 (445)
T KOG2139|consen 424 RIQRYPLT 431 (445)
T ss_pred ceEeeeeE
Confidence 88877754
No 219
>PF08662 eIF2A: Eukaryotic translation initiation factor eIF2A; InterPro: IPR013979 This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins.
Probab=99.47 E-value=8.9e-12 Score=98.16 Aligned_cols=151 Identities=21% Similarity=0.293 Sum_probs=100.5
Q ss_pred EEEEEecCCCEEEEEeC---C-------CcEEEEeC--CCCeEEEEeec-CCCCeeEEEEccCCCEEEEecC----cEEE
Q 036605 77 AGLAFAKKGRSLHVVGT---N-------GMASEMKS--EMGEVIREFKA-SEKPISSSAFLCEEKIFALASS----EVRI 139 (340)
Q Consensus 77 ~~v~~~~~~~~l~s~~~---d-------g~i~~wd~--~~~~~~~~~~~-~~~~i~~l~~~~~~~~l~~~~~----~i~i 139 (340)
..+.|+++|..|+.-.. | |...+|-+ .. .....+.. ...+|.+++|+|+|..+++..+ .|.+
T Consensus 9 ~~~~W~~~G~~l~~~~~~~~~~~~ks~~~~~~l~~~~~~~-~~~~~i~l~~~~~I~~~~WsP~g~~favi~g~~~~~v~l 87 (194)
T PF08662_consen 9 AKLHWQPSGDYLLVKVQTRVDKSGKSYYGEFELFYLNEKN-IPVESIELKKEGPIHDVAWSPNGNEFAVIYGSMPAKVTL 87 (194)
T ss_pred EEEEecccCCEEEEEEEEeeccCcceEEeeEEEEEEecCC-CccceeeccCCCceEEEEECcCCCEEEEEEccCCcccEE
Confidence 46778888876655322 1 23344443 33 23334433 3457999999999998866322 3999
Q ss_pred EECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcC--CCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCC
Q 036605 140 LSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYG--EKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGED 217 (340)
Q Consensus 140 ~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~--d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 217 (340)
||++ ++.+..+. ...+..+.|+|+|+++++++.+ .|.|.+||.+ ..+.+... .+. ....+ .| +|+
T Consensus 88 yd~~-~~~i~~~~--~~~~n~i~wsP~G~~l~~~g~~n~~G~l~~wd~~--~~~~i~~~----~~~-~~t~~--~W-sPd 154 (194)
T PF08662_consen 88 YDVK-GKKIFSFG--TQPRNTISWSPDGRFLVLAGFGNLNGDLEFWDVR--KKKKISTF----EHS-DATDV--EW-SPD 154 (194)
T ss_pred EcCc-ccEeEeec--CCCceEEEECCCCCEEEEEEccCCCcEEEEEECC--CCEEeecc----ccC-cEEEE--EE-cCC
Confidence 9997 55666664 4677899999999999998863 4679999983 33332222 222 23333 67 999
Q ss_pred CCEEEEEeC------CCcEEEEECCCCCccC
Q 036605 218 GTVILAVAE------SGVAYSWDLKTVSQDE 242 (340)
Q Consensus 218 ~~~l~~~s~------dg~i~vwd~~~~~~~~ 242 (340)
|.++++++. |+.++||++. ++++.
T Consensus 155 Gr~~~ta~t~~r~~~dng~~Iw~~~-G~~l~ 184 (194)
T PF08662_consen 155 GRYLATATTSPRLRVDNGFKIWSFQ-GRLLY 184 (194)
T ss_pred CCEEEEEEeccceeccccEEEEEec-CeEeE
Confidence 999999875 6779999985 44433
No 220
>PRK02889 tolB translocation protein TolB; Provisional
Probab=99.47 E-value=9.1e-12 Score=110.91 Aligned_cols=178 Identities=14% Similarity=0.128 Sum_probs=119.4
Q ss_pred CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCC---CcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCC
Q 036605 52 GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTN---GMASEMKSEMGEVIREFKASEKPISSSAFLCEEK 128 (340)
Q Consensus 52 g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~d---g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~ 128 (340)
..|.++|.. |.....+.. +...+.+.+|+|||+.|+..+.+ ..|.+||+.+++... +..........+|+|||+
T Consensus 176 ~~L~~~D~d-G~~~~~l~~-~~~~v~~p~wSPDG~~la~~s~~~~~~~I~~~dl~~g~~~~-l~~~~g~~~~~~~SPDG~ 252 (427)
T PRK02889 176 YQLQISDAD-GQNAQSALS-SPEPIISPAWSPDGTKLAYVSFESKKPVVYVHDLATGRRRV-VANFKGSNSAPAWSPDGR 252 (427)
T ss_pred cEEEEECCC-CCCceEecc-CCCCcccceEcCCCCEEEEEEccCCCcEEEEEECCCCCEEE-eecCCCCccceEECCCCC
Confidence 467777864 444445555 77789999999999998877643 459999999887543 333344567899999999
Q ss_pred EEEE-ec--Cc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCC
Q 036605 129 IFAL-AS--SE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHS 203 (340)
Q Consensus 129 ~l~~-~~--~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~ 203 (340)
.++. .+ +. |+++|+.++. ...+..+........|+|||++|+..+..++...||.++...+.. ..+.+ . .
T Consensus 253 ~la~~~~~~g~~~Iy~~d~~~~~-~~~lt~~~~~~~~~~wSpDG~~l~f~s~~~g~~~Iy~~~~~~g~~-~~lt~--~-g 327 (427)
T PRK02889 253 TLAVALSRDGNSQIYTVNADGSG-LRRLTQSSGIDTEPFFSPDGRSIYFTSDRGGAPQIYRMPASGGAA-QRVTF--T-G 327 (427)
T ss_pred EEEEEEccCCCceEEEEECCCCC-cEECCCCCCCCcCeEEcCCCCEEEEEecCCCCcEEEEEECCCCce-EEEec--C-C
Confidence 8864 32 22 7777776654 455655555667789999999988766656777888775343321 11111 1 1
Q ss_pred CeeeeeecCCCCCCCCEEEEEeCCC---cEEEEECCCCCc
Q 036605 204 PVAIDCKNSPNGEDGTVILAVAESG---VAYSWDLKTVSQ 240 (340)
Q Consensus 204 ~~~~~~~~~~~~~~~~~l~~~s~dg---~i~vwd~~~~~~ 240 (340)
..... ..| +|+|.+++..+.++ .|++||+.+++.
T Consensus 328 ~~~~~--~~~-SpDG~~Ia~~s~~~g~~~I~v~d~~~g~~ 364 (427)
T PRK02889 328 SYNTS--PRI-SPDGKLLAYISRVGGAFKLYVQDLATGQV 364 (427)
T ss_pred CCcCc--eEE-CCCCCEEEEEEccCCcEEEEEEECCCCCe
Confidence 11111 144 89999998877654 599999887643
No 221
>PF02239 Cytochrom_D1: Cytochrome D1 heme domain; PDB: 1NNO_B 1HZU_A 1N15_B 1N50_A 1GJQ_A 1BL9_B 1NIR_B 1N90_B 1HZV_A 1AOQ_A ....
Probab=99.46 E-value=4.2e-11 Score=103.69 Aligned_cols=189 Identities=20% Similarity=0.176 Sum_probs=126.9
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEE
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAF 123 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~ 123 (340)
++++-..+|.|.+.|..+.+.+.++.. ....-..+.|+|||+++++++.||.|.++|+.+++.+.++.... ...++++
T Consensus 8 ~~V~~~~~~~v~viD~~t~~~~~~i~~-~~~~h~~~~~s~Dgr~~yv~~rdg~vsviD~~~~~~v~~i~~G~-~~~~i~~ 85 (369)
T PF02239_consen 8 FYVVERGSGSVAVIDGATNKVVARIPT-GGAPHAGLKFSPDGRYLYVANRDGTVSVIDLATGKVVATIKVGG-NPRGIAV 85 (369)
T ss_dssp EEEEEGGGTEEEEEETTT-SEEEEEE--STTEEEEEE-TT-SSEEEEEETTSEEEEEETTSSSEEEEEE-SS-EEEEEEE
T ss_pred EEEEecCCCEEEEEECCCCeEEEEEcC-CCCceeEEEecCCCCEEEEEcCCCeEEEEECCcccEEEEEecCC-CcceEEE
Confidence 445667789999999999999999885 33334557899999999999999999999999999999987655 4578999
Q ss_pred ccCCCEEEEec---CcEEEEECCCCceeEEeecC-------CCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCcc
Q 036605 124 LCEEKIFALAS---SEVRILSLENGEEVLKFSDD-------VGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVN 193 (340)
Q Consensus 124 ~~~~~~l~~~~---~~i~i~d~~~~~~~~~~~~~-------~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~ 193 (340)
++||++++++. +.+.++|.++.+.+..+... ...+..+..+|....++..-.+.+.|.+-|. ......
T Consensus 86 s~DG~~~~v~n~~~~~v~v~D~~tle~v~~I~~~~~~~~~~~~Rv~aIv~s~~~~~fVv~lkd~~~I~vVdy--~d~~~~ 163 (369)
T PF02239_consen 86 SPDGKYVYVANYEPGTVSVIDAETLEPVKTIPTGGMPVDGPESRVAAIVASPGRPEFVVNLKDTGEIWVVDY--SDPKNL 163 (369)
T ss_dssp --TTTEEEEEEEETTEEEEEETTT--EEEEEE--EE-TTTS---EEEEEE-SSSSEEEEEETTTTEEEEEET--TTSSCE
T ss_pred cCCCCEEEEEecCCCceeEeccccccceeecccccccccccCCCceeEEecCCCCEEEEEEccCCeEEEEEe--cccccc
Confidence 99999998754 55999999999988877532 2456788888888867665664588877776 232221
Q ss_pred CCceeeecCCCeeeeeecCCCCCCCCEEEE-EeCCCcEEEEECCCCCcc
Q 036605 194 KGPALSMRHSPVAIDCKNSPNGEDGTVILA-VAESGVAYSWDLKTVSQD 241 (340)
Q Consensus 194 ~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~-~s~dg~i~vwd~~~~~~~ 241 (340)
....+..+. ...+. .+ .++++++++ ...+..|-++|..+.+..
T Consensus 164 ~~~~i~~g~--~~~D~--~~-dpdgry~~va~~~sn~i~viD~~~~k~v 207 (369)
T PF02239_consen 164 KVTTIKVGR--FPHDG--GF-DPDGRYFLVAANGSNKIAVIDTKTGKLV 207 (369)
T ss_dssp EEEEEE--T--TEEEE--EE--TTSSEEEEEEGGGTEEEEEETTTTEEE
T ss_pred ceeeecccc--ccccc--cc-CcccceeeecccccceeEEEeeccceEE
Confidence 111222222 22333 44 788887765 456778999998876544
No 222
>PRK05137 tolB translocation protein TolB; Provisional
Probab=99.46 E-value=2e-11 Score=109.23 Aligned_cols=174 Identities=10% Similarity=-0.019 Sum_probs=119.6
Q ss_pred CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeC---CCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCC
Q 036605 52 GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGT---NGMASEMKSEMGEVIREFKASEKPISSSAFLCEEK 128 (340)
Q Consensus 52 g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~---dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~ 128 (340)
..|.++|.... ....+.. |...+...+|+|||+.|+..+. +..|.+||+.+++.. .+......+...+|+|||+
T Consensus 182 ~~l~~~d~dg~-~~~~lt~-~~~~v~~p~wSpDG~~lay~s~~~g~~~i~~~dl~~g~~~-~l~~~~g~~~~~~~SPDG~ 258 (435)
T PRK05137 182 KRLAIMDQDGA-NVRYLTD-GSSLVLTPRFSPNRQEITYMSYANGRPRVYLLDLETGQRE-LVGNFPGMTFAPRFSPDGR 258 (435)
T ss_pred eEEEEECCCCC-CcEEEec-CCCCeEeeEECCCCCEEEEEEecCCCCEEEEEECCCCcEE-EeecCCCcccCcEECCCCC
Confidence 37889997554 4455665 7789999999999998887764 468999999988753 3444556677899999999
Q ss_pred EEEE-ec----CcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCC--eEEEEEccCCCCCccCCceeeec
Q 036605 129 IFAL-AS----SEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEK--HLQVWRCDISSKTVNKGPALSMR 201 (340)
Q Consensus 129 ~l~~-~~----~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~--~i~iwd~~~~~~~~~~~~~~~~~ 201 (340)
.++. .+ .+|++||+.++.. ..+..+........|+|||++|+..+..++ .|++||+ ..+.. ..+. .
T Consensus 259 ~la~~~~~~g~~~Iy~~d~~~~~~-~~Lt~~~~~~~~~~~spDG~~i~f~s~~~g~~~Iy~~d~--~g~~~-~~lt---~ 331 (435)
T PRK05137 259 KVVMSLSQGGNTDIYTMDLRSGTT-TRLTDSPAIDTSPSYSPDGSQIVFESDRSGSPQLYVMNA--DGSNP-RRIS---F 331 (435)
T ss_pred EEEEEEecCCCceEEEEECCCCce-EEccCCCCccCceeEcCCCCEEEEEECCCCCCeEEEEEC--CCCCe-EEee---c
Confidence 8754 22 2399999988754 556666666778999999999988765444 5666665 33322 2221 1
Q ss_pred CCCeeeeeecCCCCCCCCEEEEEeCC---CcEEEEECCCC
Q 036605 202 HSPVAIDCKNSPNGEDGTVILAVAES---GVAYSWDLKTV 238 (340)
Q Consensus 202 ~~~~~~~~~~~~~~~~~~~l~~~s~d---g~i~vwd~~~~ 238 (340)
........ .| +|+|.+|+..+.+ ..|.+||+...
T Consensus 332 ~~~~~~~~--~~-SpdG~~ia~~~~~~~~~~i~~~d~~~~ 368 (435)
T PRK05137 332 GGGRYSTP--VW-SPRGDLIAFTKQGGGQFSIGVMKPDGS 368 (435)
T ss_pred CCCcccCe--EE-CCCCCEEEEEEcCCCceEEEEEECCCC
Confidence 11112122 44 8999999887654 35788887543
No 223
>KOG1272 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.46 E-value=1.2e-13 Score=115.54 Aligned_cols=195 Identities=15% Similarity=0.180 Sum_probs=158.1
Q ss_pred EEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCC
Q 036605 25 SCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEM 104 (340)
Q Consensus 25 ~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~ 104 (340)
..+.++.+|+ +|+.|+..|.|-.+|..++++...+. -...|.++.|-.+.+++++ .....+++||- .
T Consensus 133 Y~~~ytrnGr---------hlllgGrKGHlAa~Dw~t~~L~~Ei~--v~Etv~Dv~~LHneq~~AV-AQK~y~yvYD~-~ 199 (545)
T KOG1272|consen 133 YHLDYTRNGR---------HLLLGGRKGHLAAFDWVTKKLHFEIN--VMETVRDVTFLHNEQFFAV-AQKKYVYVYDN-N 199 (545)
T ss_pred eeeeecCCcc---------EEEecCCccceeeeecccceeeeeee--hhhhhhhhhhhcchHHHHh-hhhceEEEecC-C
Confidence 4577888898 99999999999999999999888876 4568999999877766665 56679999995 4
Q ss_pred CeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEE
Q 036605 105 GEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQV 182 (340)
Q Consensus 105 ~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~i 182 (340)
|..++.++.+ ..+..+.|-|..-+|++++.. ++--|+.+|+.+..+....+.+..|.-+|-+..+-.|.. .|+|.+
T Consensus 200 GtElHClk~~-~~v~rLeFLPyHfLL~~~~~~G~L~Y~DVS~GklVa~~~t~~G~~~vm~qNP~NaVih~Ghs-nGtVSl 277 (545)
T KOG1272|consen 200 GTELHCLKRH-IRVARLEFLPYHFLLVAASEAGFLKYQDVSTGKLVASIRTGAGRTDVMKQNPYNAVIHLGHS-NGTVSL 277 (545)
T ss_pred CcEEeehhhc-CchhhhcccchhheeeecccCCceEEEeechhhhhHHHHccCCccchhhcCCccceEEEcCC-CceEEe
Confidence 6777777754 468899999988777776665 889999999999888777888899999998878888777 999999
Q ss_pred EEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 183 WRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 183 wd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
|.- ..++.+..+. .|...+.++ ++ .++|.|+++.+.|..++|||+++..++.
T Consensus 278 WSP--~skePLvKiL---cH~g~V~si--Av-~~~G~YMaTtG~Dr~~kIWDlR~~~ql~ 329 (545)
T KOG1272|consen 278 WSP--NSKEPLVKIL---CHRGPVSSI--AV-DRGGRYMATTGLDRKVKIWDLRNFYQLH 329 (545)
T ss_pred cCC--CCcchHHHHH---hcCCCcceE--EE-CCCCcEEeecccccceeEeeeccccccc
Confidence 997 4555444444 566555554 44 8999999999999999999999866554
No 224
>KOG3881 consensus Uncharacterized conserved protein [Function unknown]
Probab=99.45 E-value=1.2e-11 Score=101.66 Aligned_cols=142 Identities=11% Similarity=0.233 Sum_probs=120.7
Q ss_pred EEEEEcCC--CcEEEEEccCCeeEEEecCCC--------CCCeEEEEEecC--CCEEEEEeCCCcEEEEeCCCCe-EEEE
Q 036605 44 LLALGTSN--GDILAVDVLTGEMKWKSTGRH--------PGGLAGLAFAKK--GRSLHVVGTNGMASEMKSEMGE-VIRE 110 (340)
Q Consensus 44 ~l~~g~~d--g~i~i~d~~~~~~~~~~~~~h--------~~~v~~v~~~~~--~~~l~s~~~dg~i~~wd~~~~~-~~~~ 110 (340)
++|+|+.. ..+.|||++..+.++.-...- +--++++.|-+. ...|+++..-+.+++||.+.++ ++..
T Consensus 163 Iva~GGke~~n~lkiwdle~~~qiw~aKNvpnD~L~LrVPvW~tdi~Fl~g~~~~~fat~T~~hqvR~YDt~~qRRPV~~ 242 (412)
T KOG3881|consen 163 IVATGGKENINELKIWDLEQSKQIWSAKNVPNDRLGLRVPVWITDIRFLEGSPNYKFATITRYHQVRLYDTRHQRRPVAQ 242 (412)
T ss_pred eEecCchhcccceeeeecccceeeeeccCCCCccccceeeeeeccceecCCCCCceEEEEecceeEEEecCcccCcceeE
Confidence 67779888 899999999987666554311 123577888886 7899999999999999998764 6777
Q ss_pred eecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEE-eecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 111 FKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLK-FSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 111 ~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~-~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
|.....+++++...|+++++++++.. +..||++.++.+.. +.+..+.|+++..+|.+++++++|. |+.++|+|+.
T Consensus 243 fd~~E~~is~~~l~p~gn~Iy~gn~~g~l~~FD~r~~kl~g~~~kg~tGsirsih~hp~~~~las~GL-DRyvRIhD~k 320 (412)
T KOG3881|consen 243 FDFLENPISSTGLTPSGNFIYTGNTKGQLAKFDLRGGKLLGCGLKGITGSIRSIHCHPTHPVLASCGL-DRYVRIHDIK 320 (412)
T ss_pred eccccCcceeeeecCCCcEEEEecccchhheecccCceeeccccCCccCCcceEEEcCCCceEEeecc-ceeEEEeecc
Confidence 88888999999999999999887655 99999999988865 7888999999999999999999999 9999999983
No 225
>KOG0644 consensus Uncharacterized conserved protein, contains WD40 repeat and BROMO domains [General function prediction only]
Probab=99.45 E-value=1.7e-14 Score=128.49 Aligned_cols=117 Identities=16% Similarity=0.273 Sum_probs=107.2
Q ss_pred eEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEE
Q 036605 64 MKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILS 141 (340)
Q Consensus 64 ~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d 141 (340)
.+..+.+ |...|+|+.|...|.++++|++|..++||...++..+....+|.+.|+.++++.+..++++++.+ |++|-
T Consensus 182 ~ikrLlg-H~naVyca~fDrtg~~Iitgsdd~lvKiwS~et~~~lAs~rGhs~ditdlavs~~n~~iaaaS~D~vIrvWr 260 (1113)
T KOG0644|consen 182 NIKRLLG-HRNAVYCAIFDRTGRYIITGSDDRLVKIWSMETARCLASCRGHSGDITDLAVSSNNTMIAAASNDKVIRVWR 260 (1113)
T ss_pred HHHHHHh-hhhheeeeeeccccceEeecCccceeeeeeccchhhhccCCCCccccchhccchhhhhhhhcccCceEEEEe
Confidence 3445566 99999999999999999999999999999999999999999999999999999999899888888 99999
Q ss_pred CCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 142 LENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 142 ~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
+.++.++..+.+|.+.|++++|+|-. +++. ||++++||.+
T Consensus 261 l~~~~pvsvLrghtgavtaiafsP~~----sss~-dgt~~~wd~r 300 (1113)
T KOG0644|consen 261 LPDGAPVSVLRGHTGAVTAIAFSPRA----SSSD-DGTCRIWDAR 300 (1113)
T ss_pred cCCCchHHHHhccccceeeeccCccc----cCCC-CCceEecccc
Confidence 99999999999999999999999965 4455 9999999986
No 226
>KOG1517 consensus Guanine nucleotide binding protein MIP1 [Cell cycle control, cell division, chromosome partitioning]
Probab=99.44 E-value=1.3e-11 Score=113.30 Aligned_cols=201 Identities=12% Similarity=0.109 Sum_probs=132.7
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCC--CCCCeEEEEEec--CCCEEEEEeCCCcEE
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGR--HPGGLAGLAFAK--KGRSLHVVGTNGMAS 98 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~--h~~~v~~v~~~~--~~~~l~s~~~dg~i~ 98 (340)
.-..+.|+|-.. .++++...-.|++||.+.++.+..|..+ ....|+.+.+-. |...|++|+.||.|+
T Consensus 1066 ~pk~~~~hpf~p---------~i~~ad~r~~i~vwd~e~~~~l~~F~n~~~~~t~Vs~l~liNe~D~aLlLtas~dGvIR 1136 (1387)
T KOG1517|consen 1066 PPKTLKFHPFEP---------QIAAADDRERIRVWDWEKGRLLNGFDNGAFPDTRVSDLELINEQDDALLLTASSDGVIR 1136 (1387)
T ss_pred CCceeeecCCCc---------eeEEcCCcceEEEEecccCceeccccCCCCCCCccceeeeecccchhheeeeccCceEE
Confidence 445677888777 7888888889999999999987777651 235788888865 456899999999999
Q ss_pred EEeCC-C----CeEEEEeecC-------CCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEee-cCCCCeEEEEE
Q 036605 99 EMKSE-M----GEVIREFKAS-------EKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFS-DDVGPLQYVSA 163 (340)
Q Consensus 99 ~wd~~-~----~~~~~~~~~~-------~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~-~~~~~v~~~~~ 163 (340)
+|+-- + .+.+.-+.+- .+.-.-+.|.....+|+++++. |+|||......+..+. +....++++.-
T Consensus 1137 Iwk~y~~~~~~~eLVTaw~~Ls~~~~~~r~~~~v~dWqQ~~G~Ll~tGd~r~IRIWDa~~E~~~~diP~~s~t~vTaLS~ 1216 (1387)
T KOG1517|consen 1137 IWKDYADKWKKPELVTAWSSLSDQLPGARGTGLVVDWQQQSGHLLVTGDVRSIRIWDAHKEQVVADIPYGSSTLVTALSA 1216 (1387)
T ss_pred EecccccccCCceeEEeeccccccCccCCCCCeeeehhhhCCeEEecCCeeEEEEEecccceeEeecccCCCccceeecc
Confidence 99732 2 2233323211 1111335566655555554433 9999999887776663 33455666665
Q ss_pred CCC-CCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCe--eeeeecCCCCCCCC-EEEEEeCCCcEEEEECCCC
Q 036605 164 SDG-AKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPV--AIDCKNSPNGEDGT-VILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 164 s~~-~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~--~~~~~~~~~~~~~~-~l~~~s~dg~i~vwd~~~~ 238 (340)
+.. |..|++| ..||.|++||.|+...+ ......-.|... +..+ .+ .+.|. .|++|+.+|.|++||++..
T Consensus 1217 ~~~~gn~i~AG-faDGsvRvyD~R~a~~d--s~v~~~R~h~~~~~Iv~~--sl-q~~G~~elvSgs~~G~I~~~DlR~~ 1289 (1387)
T KOG1517|consen 1217 DLVHGNIIAAG-FADGSVRVYDRRMAPPD--SLVCVYREHNDVEPIVHL--SL-QRQGLGELVSGSQDGDIQLLDLRMS 1289 (1387)
T ss_pred cccCCceEEEe-ecCCceEEeecccCCcc--ccceeecccCCcccceeE--Ee-ecCCCcceeeeccCCeEEEEecccC
Confidence 433 5666665 44999999999755432 122222244444 4444 33 33333 5999999999999999874
No 227
>KOG4497 consensus Uncharacterized conserved protein WDR8, contains WD repeats [General function prediction only]
Probab=99.43 E-value=3.1e-12 Score=102.96 Aligned_cols=186 Identities=11% Similarity=0.005 Sum_probs=133.1
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCE-EEEEeCCCcEEEE
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRS-LHVVGTNGMASEM 100 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~-l~s~~~dg~i~~w 100 (340)
..|.-+.|..|.- -.|.+...++.|.+|++...+...++.. .+.++..++|+|||+. |.+...|-.|.+|
T Consensus 49 dki~yieW~ads~--------~ilC~~yk~~~vqvwsl~Qpew~ckIde-g~agls~~~WSPdgrhiL~tseF~lriTVW 119 (447)
T KOG4497|consen 49 DKIVYIEWKADSC--------HILCVAYKDPKVQVWSLVQPEWYCKIDE-GQAGLSSISWSPDGRHILLTSEFDLRITVW 119 (447)
T ss_pred HHhhheeeeccce--------eeeeeeeccceEEEEEeecceeEEEecc-CCCcceeeeECCCcceEeeeecceeEEEEE
Confidence 3455678887773 1677788999999999999999989988 7889999999999965 5556678999999
Q ss_pred eCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc-----EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEc
Q 036605 101 KSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE-----VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGY 175 (340)
Q Consensus 101 d~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~-----i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~ 175 (340)
.+.+.+... +.-.+..+..++|+|||++.+...+. +.+..-+.-..+..|....-..+.+.|+|||..|+.-..
T Consensus 120 SL~t~~~~~-~~~pK~~~kg~~f~~dg~f~ai~sRrDCkdyv~i~~c~~W~ll~~f~~dT~DltgieWsPdg~~laVwd~ 198 (447)
T KOG4497|consen 120 SLNTQKGYL-LPHPKTNVKGYAFHPDGQFCAILSRRDCKDYVQISSCKAWILLKEFKLDTIDLTGIEWSPDGNWLAVWDN 198 (447)
T ss_pred EeccceeEE-ecccccCceeEEECCCCceeeeeecccHHHHHHHHhhHHHHHHHhcCCCcccccCceECCCCcEEEEecc
Confidence 998876543 33345567899999999999886654 333333333445666666677889999999988776221
Q ss_pred C-CCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 176 G-EKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 176 ~-d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
- +-.|..|.. + -.+..+ .| +|.+++|+.|+.|+.+++.+.-+
T Consensus 199 ~Leykv~aYe~---------------~--lG~k~v--~w-sP~~qflavGsyD~~lrvlnh~t 241 (447)
T KOG4497|consen 199 VLEYKVYAYER---------------G--LGLKFV--EW-SPCNQFLAVGSYDQMLRVLNHFT 241 (447)
T ss_pred hhhheeeeeee---------------c--cceeEE--Ee-ccccceEEeeccchhhhhhceee
Confidence 0 222223322 0 111122 44 89999999999999999977655
No 228
>PRK04922 tolB translocation protein TolB; Provisional
Probab=99.41 E-value=3e-11 Score=107.90 Aligned_cols=178 Identities=16% Similarity=0.101 Sum_probs=119.0
Q ss_pred CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCC---CcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCC
Q 036605 52 GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTN---GMASEMKSEMGEVIREFKASEKPISSSAFLCEEK 128 (340)
Q Consensus 52 g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~d---g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~ 128 (340)
..|.+||.... ....+.. +...+.+++|+|||+.|+.++.+ ..|.+||+.+++... +........++.|+|||+
T Consensus 184 ~~l~i~D~~g~-~~~~lt~-~~~~v~~p~wSpDg~~la~~s~~~~~~~l~~~dl~~g~~~~-l~~~~g~~~~~~~SpDG~ 260 (433)
T PRK04922 184 YALQVADSDGY-NPQTILR-SAEPILSPAWSPDGKKLAYVSFERGRSAIYVQDLATGQREL-VASFRGINGAPSFSPDGR 260 (433)
T ss_pred EEEEEECCCCC-CceEeec-CCCccccccCCCCCCEEEEEecCCCCcEEEEEECCCCCEEE-eccCCCCccCceECCCCC
Confidence 36889998644 3445555 67789999999999998887643 469999998887543 333344456789999999
Q ss_pred EEEE-e--cC--cEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCC
Q 036605 129 IFAL-A--SS--EVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHS 203 (340)
Q Consensus 129 ~l~~-~--~~--~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~ 203 (340)
.++. . ++ +|++||+.+++. ..+..+......+.|+|||++|+.++..++...+|.++..+++. ..+.+ . .
T Consensus 261 ~l~~~~s~~g~~~Iy~~d~~~g~~-~~lt~~~~~~~~~~~spDG~~l~f~sd~~g~~~iy~~dl~~g~~-~~lt~--~-g 335 (433)
T PRK04922 261 RLALTLSRDGNPEIYVMDLGSRQL-TRLTNHFGIDTEPTWAPDGKSIYFTSDRGGRPQIYRVAASGGSA-ERLTF--Q-G 335 (433)
T ss_pred EEEEEEeCCCCceEEEEECCCCCe-EECccCCCCccceEECCCCCEEEEEECCCCCceEEEEECCCCCe-EEeec--C-C
Confidence 7754 2 22 399999988854 45555555567789999999998877656665555543244332 11111 1 1
Q ss_pred CeeeeeecCCCCCCCCEEEEEeCCC---cEEEEECCCCCc
Q 036605 204 PVAIDCKNSPNGEDGTVILAVAESG---VAYSWDLKTVSQ 240 (340)
Q Consensus 204 ~~~~~~~~~~~~~~~~~l~~~s~dg---~i~vwd~~~~~~ 240 (340)
...... .| +|+|.+++..+.++ .|++||+.+++.
T Consensus 336 ~~~~~~--~~-SpDG~~Ia~~~~~~~~~~I~v~d~~~g~~ 372 (433)
T PRK04922 336 NYNARA--SV-SPDGKKIAMVHGSGGQYRIAVMDLSTGSV 372 (433)
T ss_pred CCccCE--EE-CCCCCEEEEEECCCCceeEEEEECCCCCe
Confidence 111111 44 89999998776543 589999876543
No 229
>PRK03629 tolB translocation protein TolB; Provisional
Probab=99.41 E-value=1.3e-10 Score=103.46 Aligned_cols=176 Identities=15% Similarity=0.130 Sum_probs=117.9
Q ss_pred cEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeC---CCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCE
Q 036605 53 DILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGT---NGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKI 129 (340)
Q Consensus 53 ~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~---dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~ 129 (340)
.|.++|...... ..+.. +...+...+|+|||+.|+..+. +..|.+|++.+++.... .........++|+|||+.
T Consensus 180 ~l~~~d~dg~~~-~~lt~-~~~~~~~p~wSPDG~~la~~s~~~g~~~i~i~dl~~G~~~~l-~~~~~~~~~~~~SPDG~~ 256 (429)
T PRK03629 180 ELRVSDYDGYNQ-FVVHR-SPQPLMSPAWSPDGSKLAYVTFESGRSALVIQTLANGAVRQV-ASFPRHNGAPAFSPDGSK 256 (429)
T ss_pred eEEEEcCCCCCC-EEeec-CCCceeeeEEcCCCCEEEEEEecCCCcEEEEEECCCCCeEEc-cCCCCCcCCeEECCCCCE
Confidence 699999876543 34444 6678999999999998887543 35799999988864332 223334567899999998
Q ss_pred EEEe---cC--cEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCC
Q 036605 130 FALA---SS--EVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSP 204 (340)
Q Consensus 130 l~~~---~~--~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~ 204 (340)
|+.. ++ +|++||+.+++. ..+..+...+....|+|||+.|+.++..++...||.++...++. ..+. ....
T Consensus 257 La~~~~~~g~~~I~~~d~~tg~~-~~lt~~~~~~~~~~wSPDG~~I~f~s~~~g~~~Iy~~d~~~g~~-~~lt---~~~~ 331 (429)
T PRK03629 257 LAFALSKTGSLNLYVMDLASGQI-RQVTDGRSNNTEPTWFPDSQNLAYTSDQAGRPQVYKVNINGGAP-QRIT---WEGS 331 (429)
T ss_pred EEEEEcCCCCcEEEEEECCCCCE-EEccCCCCCcCceEECCCCCEEEEEeCCCCCceEEEEECCCCCe-EEee---cCCC
Confidence 8753 22 399999988754 44444455678899999999998877645666777654344332 1111 1111
Q ss_pred eeeeeecCCCCCCCCEEEEEeCC---CcEEEEECCCCC
Q 036605 205 VAIDCKNSPNGEDGTVILAVAES---GVAYSWDLKTVS 239 (340)
Q Consensus 205 ~~~~~~~~~~~~~~~~l~~~s~d---g~i~vwd~~~~~ 239 (340)
..... .| +|+|.+++..+.+ ..|++||+.++.
T Consensus 332 ~~~~~--~~-SpDG~~Ia~~~~~~g~~~I~~~dl~~g~ 366 (429)
T PRK03629 332 QNQDA--DV-SSDGKFMVMVSSNGGQQHIAKQDLATGG 366 (429)
T ss_pred CccCE--EE-CCCCCEEEEEEccCCCceEEEEECCCCC
Confidence 11111 34 8999998876654 358889987764
No 230
>KOG3881 consensus Uncharacterized conserved protein [Function unknown]
Probab=99.41 E-value=4.8e-11 Score=98.16 Aligned_cols=189 Identities=16% Similarity=0.108 Sum_probs=134.1
Q ss_pred eEEEEEcCCCcEEEEEccCCe----eEEEecCCCCCCeEEEEEecCCC-EEEEEeCC--CcEEEEeCCCCeEEEEeecC-
Q 036605 43 LLLALGTSNGDILAVDVLTGE----MKWKSTGRHPGGLAGLAFAKKGR-SLHVVGTN--GMASEMKSEMGEVIREFKAS- 114 (340)
Q Consensus 43 ~~l~~g~~dg~i~i~d~~~~~----~~~~~~~~h~~~v~~v~~~~~~~-~l~s~~~d--g~i~~wd~~~~~~~~~~~~~- 114 (340)
..|++|..+|.+.+|..+.+. .+..+.. + ..+..+.-++... .+++||.. ..+.+||++..+.+..-+.-
T Consensus 116 g~Litc~~sG~l~~~~~k~~d~hss~l~~la~-g-~g~~~~r~~~~~p~Iva~GGke~~n~lkiwdle~~~qiw~aKNvp 193 (412)
T KOG3881|consen 116 GTLITCVSSGNLQVRHDKSGDLHSSKLIKLAT-G-PGLYDVRQTDTDPYIVATGGKENINELKIWDLEQSKQIWSAKNVP 193 (412)
T ss_pred CEEEEEecCCcEEEEeccCCccccccceeeec-C-CceeeeccCCCCCceEecCchhcccceeeeecccceeeeeccCCC
Confidence 368899999999999988543 2223332 3 4566666666444 55668887 78999999988655442211
Q ss_pred --------CCCeeEEEEccC--CCEEEEecCc--EEEEECCCC-ceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEE
Q 036605 115 --------EKPISSSAFLCE--EKIFALASSE--VRILSLENG-EEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQ 181 (340)
Q Consensus 115 --------~~~i~~l~~~~~--~~~l~~~~~~--i~i~d~~~~-~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~ 181 (340)
.-.++++.|-+. ...++++.+. +++||.+.+ +++..|.....+++++...|++++++++.. -+.+.
T Consensus 194 nD~L~LrVPvW~tdi~Fl~g~~~~~fat~T~~hqvR~YDt~~qRRPV~~fd~~E~~is~~~l~p~gn~Iy~gn~-~g~l~ 272 (412)
T KOG3881|consen 194 NDRLGLRVPVWITDIRFLEGSPNYKFATITRYHQVRLYDTRHQRRPVAQFDFLENPISSTGLTPSGNFIYTGNT-KGQLA 272 (412)
T ss_pred CccccceeeeeeccceecCCCCCceEEEEecceeEEEecCcccCcceeEeccccCcceeeeecCCCcEEEEecc-cchhh
Confidence 112467788877 6777776554 999999876 456788878899999999999999999777 89999
Q ss_pred EEEccCCCCCccCC-ceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 182 VWRCDISSKTVNKG-PALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 182 iwd~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
.||++ .+..... +. .+......+.+ +|.+.++++++-|..|+|+|+.+.+.+.
T Consensus 273 ~FD~r--~~kl~g~~~k-g~tGsirsih~-----hp~~~~las~GLDRyvRIhD~ktrkll~ 326 (412)
T KOG3881|consen 273 KFDLR--GGKLLGCGLK-GITGSIRSIHC-----HPTHPVLASCGLDRYVRIHDIKTRKLLH 326 (412)
T ss_pred eeccc--CceeeccccC-CccCCcceEEE-----cCCCceEEeeccceeEEEeecccchhhh
Confidence 99984 4333222 22 11122233333 7888999999999999999999955544
No 231
>PRK01029 tolB translocation protein TolB; Provisional
Probab=99.41 E-value=1.6e-10 Score=102.61 Aligned_cols=203 Identities=12% Similarity=0.047 Sum_probs=121.6
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCC--CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeC-----
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSN--GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGT----- 93 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~d--g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~----- 93 (340)
...+..-+|||||++ ..++++...+ ..|++.++.+++.. .+.. ..+.....+|+|||+.|+..+.
T Consensus 184 ~~~~~sP~wSPDG~~------~~~~y~S~~~g~~~I~~~~l~~g~~~-~lt~-~~g~~~~p~wSPDG~~Laf~s~~~g~~ 255 (428)
T PRK01029 184 HSLSITPTWMHIGSG------FPYLYVSYKLGVPKIFLGSLENPAGK-KILA-LQGNQLMPTFSPRKKLLAFISDRYGNP 255 (428)
T ss_pred CCCcccceEccCCCc------eEEEEEEccCCCceEEEEECCCCCce-Eeec-CCCCccceEECCCCCEEEEEECCCCCc
Confidence 345667799999860 0022244444 46888898887643 3443 4556667899999998877553
Q ss_pred CCcEEEEeCCCC---eEEEEeecCCCCeeEEEEccCCCEEEEec---Cc--EEEEECCC-CceeEEeecCCCCeEEEEEC
Q 036605 94 NGMASEMKSEMG---EVIREFKASEKPISSSAFLCEEKIFALAS---SE--VRILSLEN-GEEVLKFSDDVGPLQYVSAS 164 (340)
Q Consensus 94 dg~i~~wd~~~~---~~~~~~~~~~~~i~~l~~~~~~~~l~~~~---~~--i~i~d~~~-~~~~~~~~~~~~~v~~~~~s 164 (340)
+..+..|++..+ ................+|+|||+.|+..+ +. |+++++.. +.....+..+...+....|+
T Consensus 256 di~~~~~~~~~g~~g~~~~lt~~~~~~~~~p~wSPDG~~Laf~s~~~g~~~ly~~~~~~~g~~~~~lt~~~~~~~~p~wS 335 (428)
T PRK01029 256 DLFIQSFSLETGAIGKPRRLLNEAFGTQGNPSFSPDGTRLVFVSNKDGRPRIYIMQIDPEGQSPRLLTKKYRNSSCPAWS 335 (428)
T ss_pred ceeEEEeecccCCCCcceEeecCCCCCcCCeEECCCCCEEEEEECCCCCceEEEEECcccccceEEeccCCCCccceeEC
Confidence 223444776653 33222322223446789999999876532 22 66666643 23344455555567789999
Q ss_pred CCCCEEEEEEcCC--CeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeC---CCcEEEEECCCCC
Q 036605 165 DGAKIIITAGYGE--KHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAE---SGVAYSWDLKTVS 239 (340)
Q Consensus 165 ~~~~~l~s~~~~d--~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~---dg~i~vwd~~~~~ 239 (340)
|||++|+..+..+ ..|.+||+ .+++.. .+. ......... .| +|||..|+..+. .+.|+++++..++
T Consensus 336 PDG~~Laf~~~~~g~~~I~v~dl--~~g~~~-~Lt---~~~~~~~~p--~w-SpDG~~L~f~~~~~g~~~L~~vdl~~g~ 406 (428)
T PRK01029 336 PDGKKIAFCSVIKGVRQICVYDL--ATGRDY-QLT---TSPENKESP--SW-AIDSLHLVYSAGNSNESELYLISLITKK 406 (428)
T ss_pred CCCCEEEEEEcCCCCcEEEEEEC--CCCCeE-Ecc---CCCCCccce--EE-CCCCCEEEEEECCCCCceEEEEECCCCC
Confidence 9999998866533 36888887 444321 111 111111122 45 889988875443 3468888887654
Q ss_pred c
Q 036605 240 Q 240 (340)
Q Consensus 240 ~ 240 (340)
.
T Consensus 407 ~ 407 (428)
T PRK01029 407 T 407 (428)
T ss_pred E
Confidence 3
No 232
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=99.38 E-value=1.8e-09 Score=93.50 Aligned_cols=200 Identities=14% Similarity=0.174 Sum_probs=130.9
Q ss_pred CeEEEEeeccccccccccCceEEEEEc-CCCcEEEEEccC-CeeEEE---ec---------CCCCCCeEEEEEecCCCEE
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGT-SNGDILAVDVLT-GEMKWK---ST---------GRHPGGLAGLAFAKKGRSL 88 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~-~dg~i~i~d~~~-~~~~~~---~~---------~~h~~~v~~v~~~~~~~~l 88 (340)
....++++|+++ +|+++. .+|.|.+|++.. |..... +. ........++.|+|++++|
T Consensus 88 ~p~~i~~~~~g~---------~l~vany~~g~v~v~~l~~~g~l~~~~~~~~~~g~g~~~~rq~~~h~H~v~~~pdg~~v 158 (345)
T PF10282_consen 88 SPCHIAVDPDGR---------FLYVANYGGGSVSVFPLDDDGSLGEVVQTVRHEGSGPNPDRQEGPHPHQVVFSPDGRFV 158 (345)
T ss_dssp CEEEEEECTTSS---------EEEEEETTTTEEEEEEECTTSEEEEEEEEEESEEEESSTTTTSSTCEEEEEE-TTSSEE
T ss_pred CcEEEEEecCCC---------EEEEEEccCCeEEEEEccCCcccceeeeecccCCCCCcccccccccceeEEECCCCCEE
Confidence 344678888887 676665 689999999987 443222 11 0123457899999999999
Q ss_pred EEEeCC-CcEEEEeCCCCe--EE--EEee-cCCCCeeEEEEccCCCEEEEe---cCcEEEEECC--CCce--eEEeecC-
Q 036605 89 HVVGTN-GMASEMKSEMGE--VI--REFK-ASEKPISSSAFLCEEKIFALA---SSEVRILSLE--NGEE--VLKFSDD- 154 (340)
Q Consensus 89 ~s~~~d-g~i~~wd~~~~~--~~--~~~~-~~~~~i~~l~~~~~~~~l~~~---~~~i~i~d~~--~~~~--~~~~~~~- 154 (340)
++.... ..|.+|++.... .. ..+. ........++|+|+++++++. ++.|.+|++. .+.. +..+...
T Consensus 159 ~v~dlG~D~v~~~~~~~~~~~l~~~~~~~~~~G~GPRh~~f~pdg~~~Yv~~e~s~~v~v~~~~~~~g~~~~~~~~~~~~ 238 (345)
T PF10282_consen 159 YVPDLGADRVYVYDIDDDTGKLTPVDSIKVPPGSGPRHLAFSPDGKYAYVVNELSNTVSVFDYDPSDGSLTEIQTISTLP 238 (345)
T ss_dssp EEEETTTTEEEEEEE-TTS-TEEEEEEEECSTTSSEEEEEE-TTSSEEEEEETTTTEEEEEEEETTTTEEEEEEEEESCE
T ss_pred EEEecCCCEEEEEEEeCCCceEEEeeccccccCCCCcEEEEcCCcCEEEEecCCCCcEEEEeecccCCceeEEEEeeecc
Confidence 887543 478999887654 32 2222 234567899999999999774 4448888887 4422 2222211
Q ss_pred -----CCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeee-cCCCeeeeeecCCCCCCCCEEEEEe-CC
Q 036605 155 -----VGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSM-RHSPVAIDCKNSPNGEDGTVILAVA-ES 227 (340)
Q Consensus 155 -----~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~l~~~s-~d 227 (340)
......++++|||++|+++....+.|.+|+++..++.....-.... +..|..+.+ +++|.+|+++. .+
T Consensus 239 ~~~~~~~~~~~i~ispdg~~lyvsnr~~~sI~vf~~d~~~g~l~~~~~~~~~G~~Pr~~~~-----s~~g~~l~Va~~~s 313 (345)
T PF10282_consen 239 EGFTGENAPAEIAISPDGRFLYVSNRGSNSISVFDLDPATGTLTLVQTVPTGGKFPRHFAF-----SPDGRYLYVANQDS 313 (345)
T ss_dssp TTSCSSSSEEEEEE-TTSSEEEEEECTTTEEEEEEECTTTTTEEEEEEEEESSSSEEEEEE------TTSSEEEEEETTT
T ss_pred ccccccCCceeEEEecCCCEEEEEeccCCEEEEEEEecCCCceEEEEEEeCCCCCccEEEE-----eCCCCEEEEEecCC
Confidence 1257889999999999999888999999999544443322222222 333555555 89999998877 55
Q ss_pred CcEEEEECC
Q 036605 228 GVAYSWDLK 236 (340)
Q Consensus 228 g~i~vwd~~ 236 (340)
+.|.+|++.
T Consensus 314 ~~v~vf~~d 322 (345)
T PF10282_consen 314 NTVSVFDID 322 (345)
T ss_dssp TEEEEEEEE
T ss_pred CeEEEEEEe
Confidence 689999764
No 233
>KOG2321 consensus WD40 repeat protein [General function prediction only]
Probab=99.38 E-value=1.1e-11 Score=106.72 Aligned_cols=168 Identities=16% Similarity=0.190 Sum_probs=134.4
Q ss_pred cCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecC-----CCCCC--
Q 036605 3 STNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTG-----RHPGG-- 75 (340)
Q Consensus 3 d~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~-----~h~~~-- 75 (340)
|++.|+.+..|. .....++++..++-.. +|++|+.+|.|..||........++.. .|.+.
T Consensus 161 NLEqGrfL~P~~----~~~~~lN~v~in~~hg---------Lla~Gt~~g~VEfwDpR~ksrv~~l~~~~~v~s~pg~~~ 227 (703)
T KOG2321|consen 161 NLEQGRFLNPFE----TDSGELNVVSINEEHG---------LLACGTEDGVVEFWDPRDKSRVGTLDAASSVNSHPGGDA 227 (703)
T ss_pred Eccccccccccc----cccccceeeeecCccc---------eEEecccCceEEEecchhhhhheeeecccccCCCccccc
Confidence 567777777666 4558899999999888 999999999999999988765555432 14443
Q ss_pred ---eEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEee-cCCCCeeEEEEccC--CCEEEEecCc-EEEEECCCCcee
Q 036605 76 ---LAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFK-ASEKPISSSAFLCE--EKIFALASSE-VRILSLENGEEV 148 (340)
Q Consensus 76 ---v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~-~~~~~i~~l~~~~~--~~~l~~~~~~-i~i~d~~~~~~~ 148 (340)
|+++.|+.+|-.+++|..+|.|.+||+++.+++..-. ....+|..+.|.+. +..+++++.. ++|||-.+|+..
T Consensus 228 ~~svTal~F~d~gL~~aVGts~G~v~iyDLRa~~pl~~kdh~~e~pi~~l~~~~~~~q~~v~S~Dk~~~kiWd~~~Gk~~ 307 (703)
T KOG2321|consen 228 APSVTALKFRDDGLHVAVGTSTGSVLIYDLRASKPLLVKDHGYELPIKKLDWQDTDQQNKVVSMDKRILKIWDECTGKPM 307 (703)
T ss_pred cCcceEEEecCCceeEEeeccCCcEEEEEcccCCceeecccCCccceeeecccccCCCceEEecchHHhhhcccccCCce
Confidence 9999999989999999999999999999988765432 33457888998775 5678888877 999999999887
Q ss_pred EEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 149 LKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 149 ~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
..+.. ...+..+++-|++-.++++.. +..+..|-+
T Consensus 308 asiEp-t~~lND~C~~p~sGm~f~Ane-~~~m~~yyi 342 (703)
T KOG2321|consen 308 ASIEP-TSDLNDFCFVPGSGMFFTANE-SSKMHTYYI 342 (703)
T ss_pred eeccc-cCCcCceeeecCCceEEEecC-CCcceeEEc
Confidence 77653 456899999999888888666 777777766
No 234
>KOG1334 consensus WD40 repeat protein [General function prediction only]
Probab=99.37 E-value=1.9e-11 Score=103.26 Aligned_cols=218 Identities=15% Similarity=0.184 Sum_probs=143.2
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCC--------------------------
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGR-------------------------- 71 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~-------------------------- 71 (340)
..|.+.|..+.|...|. .|++|+.|..|.+||...+.....+..+
T Consensus 139 ~~H~GcVntV~FN~~Gd---------~l~SgSDD~~vv~WdW~~~~~~l~f~SGH~~NvfQaKFiP~s~d~ti~~~s~dg 209 (559)
T KOG1334|consen 139 NKHKGCVNTVHFNQRGD---------VLASGSDDLQVVVWDWVSGSPKLSFESGHCNNVFQAKFIPFSGDRTIVTSSRDG 209 (559)
T ss_pred cCCCCccceeeecccCc---------eeeccCccceEEeehhhccCcccccccccccchhhhhccCCCCCcCceeccccC
Confidence 38999999999999998 8999999999999998776655554333
Q ss_pred ---------------------CCCCeEEEEEecCC-CEEEEEeCCCcEEEEeCCCCeEEEEee---cCCC---CeeEEEE
Q 036605 72 ---------------------HPGGLAGLAFAKKG-RSLHVVGTNGMASEMKSEMGEVIREFK---ASEK---PISSSAF 123 (340)
Q Consensus 72 ---------------------h~~~v~~v~~~~~~-~~l~s~~~dg~i~~wd~~~~~~~~~~~---~~~~---~i~~l~~ 123 (340)
|.+.|.-++.-|+. ..|++++.|+.+.-+|++++.+...+. .+.. ..+.++.
T Consensus 210 qvr~s~i~~t~~~e~t~rl~~h~g~vhklav~p~sp~~f~S~geD~~v~~~Dlr~~~pa~~~~cr~~~~~~~v~L~~Ia~ 289 (559)
T KOG1334|consen 210 QVRVSEILETGYVENTKRLAPHEGPVHKLAVEPDSPKPFLSCGEDAVVFHIDLRQDVPAEKFVCREADEKERVGLYTIAV 289 (559)
T ss_pred ceeeeeeccccceecceecccccCccceeeecCCCCCcccccccccceeeeeeccCCccceeeeeccCCccceeeeeEec
Confidence 44555555555533 346667777777777776665433332 2222 4678888
Q ss_pred ccCCCE-EEEecCc--EEEEECCCCc------eeEEeec------CCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCC
Q 036605 124 LCEEKI-FALASSE--VRILSLENGE------EVLKFSD------DVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDIS 188 (340)
Q Consensus 124 ~~~~~~-l~~~~~~--i~i~d~~~~~------~~~~~~~------~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~ 188 (340)
.|...+ +++++.+ +++||.+.-. .+.+|.. ....|++++|+.++.-|+++-. |-.|++|.-...
T Consensus 290 ~P~nt~~faVgG~dqf~RvYD~R~~~~e~~n~~~~~f~p~hl~~d~~v~ITgl~Ysh~~sElLaSYn-De~IYLF~~~~~ 368 (559)
T KOG1334|consen 290 DPRNTNEFAVGGSDQFARVYDQRRIDKEENNGVLDKFCPHHLVEDDPVNITGLVYSHDGSELLASYN-DEDIYLFNKSMG 368 (559)
T ss_pred CCCCccccccCChhhhhhhhcccchhhccccchhhhcCCccccccCcccceeEEecCCccceeeeec-ccceEEeccccc
Confidence 887764 4555555 8999876422 2233322 2357899999988777777555 899999965332
Q ss_pred CCCccCCce--------eeecCCCee-eeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCC
Q 036605 189 SKTVNKGPA--------LSMRHSPVA-IDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 189 ~~~~~~~~~--------~~~~~~~~~-~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p 246 (340)
.+...-... ...+|...- +.-...| .|...|+++|+.-|.|.||+-.+++.+..++.
T Consensus 369 ~G~~p~~~s~~~~~~k~vYKGHrN~~TVKgVNFf-GPrsEyVvSGSDCGhIFiW~K~t~eii~~Meg 434 (559)
T KOG1334|consen 369 DGSEPDPSSPREQYVKRVYKGHRNSRTVKGVNFF-GPRSEYVVSGSDCGHIFIWDKKTGEIIRFMEG 434 (559)
T ss_pred cCCCCCCCcchhhccchhhcccccccccceeeec-cCccceEEecCccceEEEEecchhHHHHHhhc
Confidence 231111000 011333221 2222334 89999999999999999999999888876666
No 235
>KOG4227 consensus WD40 repeat protein [General function prediction only]
Probab=99.37 E-value=3e-11 Score=99.51 Aligned_cols=164 Identities=15% Similarity=0.127 Sum_probs=121.8
Q ss_pred ecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCC------CeEEEEee-cCCCCeeEEEEccCCCEEEEecCc--EE
Q 036605 68 STGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEM------GEVIREFK-ASEKPISSSAFLCEEKIFALASSE--VR 138 (340)
Q Consensus 68 ~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~------~~~~~~~~-~~~~~i~~l~~~~~~~~l~~~~~~--i~ 138 (340)
+.+ |.+.|+++.|+.++++|++|+.|..+++|.+.. .+++.... .|...|.|++|....++++++++. |.
T Consensus 52 ~~~-H~GCiNAlqFS~N~~~L~SGGDD~~~~~W~~de~~~~k~~KPI~~~~~~H~SNIF~L~F~~~N~~~~SG~~~~~VI 130 (609)
T KOG4227|consen 52 VRE-HTGCINALQFSHNDRFLASGGDDMHGRVWNVDELMVRKTPKPIGVMEHPHRSNIFSLEFDLENRFLYSGERWGTVI 130 (609)
T ss_pred hhh-hccccceeeeccCCeEEeecCCcceeeeechHHHHhhcCCCCceeccCccccceEEEEEccCCeeEecCCCcceeE
Confidence 344 999999999999999999999999999999753 23444333 345789999999999999997766 88
Q ss_pred EEECCCCceeEEee--cCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCC
Q 036605 139 ILSLENGEEVLKFS--DDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGE 216 (340)
Q Consensus 139 i~d~~~~~~~~~~~--~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 216 (340)
+.|+++.+.+..+. ...+.|..+..+|..+.|++... ++.|.+||.+. .... ..+.+.-..+..+..+ -|...
T Consensus 131 ~HDiEt~qsi~V~~~~~~~~~VY~m~~~P~DN~~~~~t~-~~~V~~~D~Rd-~~~~-~~~~~~AN~~~~F~t~--~F~P~ 205 (609)
T KOG4227|consen 131 KHDIETKQSIYVANENNNRGDVYHMDQHPTDNTLIVVTR-AKLVSFIDNRD-RQNP-ISLVLPANSGKNFYTA--EFHPE 205 (609)
T ss_pred eeecccceeeeeecccCcccceeecccCCCCceEEEEec-CceEEEEeccC-CCCC-CceeeecCCCccceee--eecCC
Confidence 99999998876663 33468999999999888888777 99999999852 2211 1222222233333333 44344
Q ss_pred CCCEEEEEeCCCcEEEEECCC
Q 036605 217 DGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 217 ~~~~l~~~s~dg~i~vwd~~~ 237 (340)
...+|++.+..|-+-+||...
T Consensus 206 ~P~Li~~~~~~~G~~~~D~R~ 226 (609)
T KOG4227|consen 206 TPALILVNSETGGPNVFDRRM 226 (609)
T ss_pred CceeEEeccccCCCCceeecc
Confidence 567788888888899999875
No 236
>KOG1523 consensus Actin-related protein Arp2/3 complex, subunit ARPC1/p41-ARC [Cytoskeleton]
Probab=99.34 E-value=8e-11 Score=94.53 Aligned_cols=159 Identities=8% Similarity=-0.001 Sum_probs=120.6
Q ss_pred CCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCe---EEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCC-C
Q 036605 72 HPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGE---VIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLEN-G 145 (340)
Q Consensus 72 h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~---~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~-~ 145 (340)
..++|+|.+|++|...++.+-....|.+|...... ..+++..|...|+.++|+|..+.+++++.+ -++|.... +
T Consensus 9 ~~~pitchAwn~drt~iAv~~~~~evhiy~~~~~~~w~~~htls~Hd~~vtgvdWap~snrIvtcs~drnayVw~~~~~~ 88 (361)
T KOG1523|consen 9 LLEPITCHAWNSDRTQIAVSPNNHEVHIYSMLGADLWEPAHTLSEHDKIVTGVDWAPKSNRIVTCSHDRNAYVWTQPSGG 88 (361)
T ss_pred ccCceeeeeecCCCceEEeccCCceEEEEEecCCCCceeceehhhhCcceeEEeecCCCCceeEccCCCCccccccCCCC
Confidence 34689999999999999999999999999876654 567788999999999999999999886655 99999843 3
Q ss_pred --ceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEE
Q 036605 146 --EEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILA 223 (340)
Q Consensus 146 --~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~ 223 (340)
++...+.-+....+++.|+|.++.|++++. .+.|.||-+..+..=-..... ...+...+..+ .| +|++-.|++
T Consensus 89 ~WkptlvLlRiNrAAt~V~WsP~enkFAVgSg-ar~isVcy~E~ENdWWVsKhi-kkPirStv~sl--dW-hpnnVLlaa 163 (361)
T KOG1523|consen 89 TWKPTLVLLRINRAATCVKWSPKENKFAVGSG-ARLISVCYYEQENDWWVSKHI-KKPIRSTVTSL--DW-HPNNVLLAA 163 (361)
T ss_pred eeccceeEEEeccceeeEeecCcCceEEeccC-ccEEEEEEEecccceehhhhh-CCccccceeee--ec-cCCcceecc
Confidence 233455667889999999999999999777 899999998322110000000 00112233333 66 899999999
Q ss_pred EeCCCcEEEEEC
Q 036605 224 VAESGVAYSWDL 235 (340)
Q Consensus 224 ~s~dg~i~vwd~ 235 (340)
|+.|+..+||..
T Consensus 164 Gs~D~k~rVfSa 175 (361)
T KOG1523|consen 164 GSTDGKCRVFSA 175 (361)
T ss_pred cccCcceeEEEE
Confidence 999999999965
No 237
>KOG2321 consensus WD40 repeat protein [General function prediction only]
Probab=99.33 E-value=1.5e-10 Score=99.92 Aligned_cols=211 Identities=15% Similarity=0.152 Sum_probs=143.6
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecC----------------------------
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTG---------------------------- 70 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~---------------------------- 70 (340)
.+....+.|..+|||+ -++|+|..--.|++||+.+-.+. |..
T Consensus 49 e~p~ast~ik~s~DGq--------Y~lAtG~YKP~ikvydlanLSLK--FERhlDae~V~feiLsDD~SK~v~L~~DR~I 118 (703)
T KOG2321|consen 49 EMPTASTRIKVSPDGQ--------YLLATGTYKPQIKVYDLANLSLK--FERHLDAEVVDFEILSDDYSKSVFLQNDRTI 118 (703)
T ss_pred CCccccceeEecCCCc--------EEEEecccCCceEEEEcccceee--eeecccccceeEEEeccchhhheEeecCcee
Confidence 5778889999999995 16778999999999998754321 111
Q ss_pred -------CC-C----CCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--
Q 036605 71 -------RH-P----GGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE-- 136 (340)
Q Consensus 71 -------~h-~----~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~-- 136 (340)
.| . ..-..++++.-..-|+.++....|+-++++.|..+..|.....+++++.+++-..+|++|+.+
T Consensus 119 efHak~G~hy~~RIP~~GRDm~y~~~scDly~~gsg~evYRlNLEqGrfL~P~~~~~~~lN~v~in~~hgLla~Gt~~g~ 198 (703)
T KOG2321|consen 119 EFHAKYGRHYRTRIPKFGRDMKYHKPSCDLYLVGSGSEVYRLNLEQGRFLNPFETDSGELNVVSINEEHGLLACGTEDGV 198 (703)
T ss_pred eehhhcCeeeeeecCcCCccccccCCCccEEEeecCcceEEEEccccccccccccccccceeeeecCccceEEecccCce
Confidence 00 0 011233444334457777777889999999999998888888899999999998888886644
Q ss_pred EEEEECCCCceeEEe------ecCCC-----CeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCe
Q 036605 137 VRILSLENGEEVLKF------SDDVG-----PLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPV 205 (340)
Q Consensus 137 i~i~d~~~~~~~~~~------~~~~~-----~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~ 205 (340)
|-.||.++...+..+ ..|++ .|+++.|+.+|-.+.+|.. +|.+.|||++....-..... ...-.
T Consensus 199 VEfwDpR~ksrv~~l~~~~~v~s~pg~~~~~svTal~F~d~gL~~aVGts-~G~v~iyDLRa~~pl~~kdh----~~e~p 273 (703)
T KOG2321|consen 199 VEFWDPRDKSRVGTLDAASSVNSHPGGDAAPSVTALKFRDDGLHVAVGTS-TGSVLIYDLRASKPLLVKDH----GYELP 273 (703)
T ss_pred EEEecchhhhhheeeecccccCCCccccccCcceEEEecCCceeEEeecc-CCcEEEEEcccCCceeeccc----CCccc
Confidence 999999887655444 23443 3999999999988888777 99999999963322111111 11222
Q ss_pred eeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCC
Q 036605 206 AIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 206 ~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p 246 (340)
+..+ .|...++.-.+.......++|||-.+++....+.|
T Consensus 274 i~~l--~~~~~~~q~~v~S~Dk~~~kiWd~~~Gk~~asiEp 312 (703)
T KOG2321|consen 274 IKKL--DWQDTDQQNKVVSMDKRILKIWDECTGKPMASIEP 312 (703)
T ss_pred eeee--cccccCCCceEEecchHHhhhcccccCCceeeccc
Confidence 2223 44222333333334455689999999887776666
No 238
>KOG0974 consensus WD-repeat protein WDR6, WD repeat superfamily [General function prediction only]
Probab=99.33 E-value=2.3e-11 Score=111.42 Aligned_cols=138 Identities=16% Similarity=0.277 Sum_probs=117.3
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEE-EeecCCCCeeEEE
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIR-EFKASEKPISSSA 122 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~-~~~~~~~~i~~l~ 122 (340)
++++|+.-+.|.+|+....+....+.+ |.+.|..+.|+-||.+++++++|..+++|++.+++... ..-+|...+..+.
T Consensus 147 ~i~~gsv~~~iivW~~~~dn~p~~l~G-HeG~iF~i~~s~dg~~i~s~SdDRsiRlW~i~s~~~~~~~~fgHsaRvw~~~ 225 (967)
T KOG0974|consen 147 YIASGSVFGEIIVWKPHEDNKPIRLKG-HEGSIFSIVTSLDGRYIASVSDDRSIRLWPIDSREVLGCTGFGHSARVWACC 225 (967)
T ss_pred EEEeccccccEEEEeccccCCcceecc-cCCceEEEEEccCCcEEEEEecCcceeeeecccccccCcccccccceeEEEE
Confidence 799999999999999885444446777 99999999999999999999999999999999988766 5567999999999
Q ss_pred EccCCCEEEEecCc--EEEEECCCCceeEEeecCC-CCeEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 123 FLCEEKIFALASSE--VRILSLENGEEVLKFSDDV-GPLQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 123 ~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~-~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
+.|. .+++++.+ .++|+.. ++.+..+..|. ..+..++..++...+++++. |+.+++|++.
T Consensus 226 ~~~n--~i~t~gedctcrvW~~~-~~~l~~y~~h~g~~iw~~~~~~~~~~~vT~g~-Ds~lk~~~l~ 288 (967)
T KOG0974|consen 226 FLPN--RIITVGEDCTCRVWGVN-GTQLEVYDEHSGKGIWKIAVPIGVIIKVTGGN-DSTLKLWDLN 288 (967)
T ss_pred eccc--eeEEeccceEEEEEecc-cceehhhhhhhhcceeEEEEcCCceEEEeecc-Ccchhhhhhh
Confidence 9998 77776666 8999654 44555777776 56889999999888888888 9999999983
No 239
>COG2706 3-carboxymuconate cyclase [Carbohydrate transport and metabolism]
Probab=99.32 E-value=3.3e-09 Score=87.08 Aligned_cols=196 Identities=12% Similarity=0.158 Sum_probs=134.2
Q ss_pred EEEEeeccccccccccCceEEEEEc-CCCcEEEEEccC-CeeEEE--ecCCCCCC----------eEEEEEecCCCEEEE
Q 036605 25 SCLACGFVGKKRRKERGTLLLALGT-SNGDILAVDVLT-GEMKWK--STGRHPGG----------LAGLAFAKKGRSLHV 90 (340)
Q Consensus 25 ~~l~~sp~~~~~~~~~~~~~l~~g~-~dg~i~i~d~~~-~~~~~~--~~~~h~~~----------v~~v~~~~~~~~l~s 90 (340)
+-++++++++ +|+++. ..|.|.++-+.. |.+... ... |.+. +....|.|++++|++
T Consensus 92 ~yvsvd~~g~---------~vf~AnY~~g~v~v~p~~~dG~l~~~v~~~~-h~g~~p~~rQ~~~h~H~a~~tP~~~~l~v 161 (346)
T COG2706 92 CYVSVDEDGR---------FVFVANYHSGSVSVYPLQADGSLQPVVQVVK-HTGSGPHERQESPHVHSANFTPDGRYLVV 161 (346)
T ss_pred eEEEECCCCC---------EEEEEEccCceEEEEEcccCCccccceeeee-cCCCCCCccccCCccceeeeCCCCCEEEE
Confidence 6788899998 777765 458999999865 442221 111 5544 888899999999999
Q ss_pred EeCC-CcEEEEeCCCCeEEEE----eecCCCCeeEEEEccCCCEEEE---ecCcEEEEECCCC-ceeEEeecC-------
Q 036605 91 VGTN-GMASEMKSEMGEVIRE----FKASEKPISSSAFLCEEKIFAL---ASSEVRILSLENG-EEVLKFSDD------- 154 (340)
Q Consensus 91 ~~~d-g~i~~wd~~~~~~~~~----~~~~~~~i~~l~~~~~~~~l~~---~~~~i~i~d~~~~-~~~~~~~~~------- 154 (340)
++-. -.|.+|++..|..... + ........|.|+|++++..+ -+++|-+|..... ..+..++.+
T Consensus 162 ~DLG~Dri~~y~~~dg~L~~~~~~~v-~~G~GPRHi~FHpn~k~aY~v~EL~stV~v~~y~~~~g~~~~lQ~i~tlP~dF 240 (346)
T COG2706 162 PDLGTDRIFLYDLDDGKLTPADPAEV-KPGAGPRHIVFHPNGKYAYLVNELNSTVDVLEYNPAVGKFEELQTIDTLPEDF 240 (346)
T ss_pred eecCCceEEEEEcccCcccccccccc-CCCCCcceEEEcCCCcEEEEEeccCCEEEEEEEcCCCceEEEeeeeccCcccc
Confidence 8643 3899999998764322 2 23456689999999999876 4556888887663 223222211
Q ss_pred --CCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCc-eeeecCCCeeeeeecCCCCCCCCEEEEEeCCC-cE
Q 036605 155 --VGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGP-ALSMRHSPVAIDCKNSPNGEDGTVILAVAESG-VA 230 (340)
Q Consensus 155 --~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg-~i 230 (340)
......+.+++||++|+++......|.+|.++..++...... ....+..|..+.+ .+.+.+|+++..++ .|
T Consensus 241 ~g~~~~aaIhis~dGrFLYasNRg~dsI~~f~V~~~~g~L~~~~~~~teg~~PR~F~i-----~~~g~~Liaa~q~sd~i 315 (346)
T COG2706 241 TGTNWAAAIHISPDGRFLYASNRGHDSIAVFSVDPDGGKLELVGITPTEGQFPRDFNI-----NPSGRFLIAANQKSDNI 315 (346)
T ss_pred CCCCceeEEEECCCCCEEEEecCCCCeEEEEEEcCCCCEEEEEEEeccCCcCCcccee-----CCCCCEEEEEccCCCcE
Confidence 245678899999999999888888999999975544321111 1112333555555 78889998887764 58
Q ss_pred EEEECC
Q 036605 231 YSWDLK 236 (340)
Q Consensus 231 ~vwd~~ 236 (340)
.+|...
T Consensus 316 ~vf~~d 321 (346)
T COG2706 316 TVFERD 321 (346)
T ss_pred EEEEEc
Confidence 888654
No 240
>KOG1064 consensus RAVE (regulator of V-ATPase assembly) complex subunit RAV1/DMX protein, WD repeat superfamily [General function prediction only]
Probab=99.32 E-value=1.7e-11 Score=117.94 Aligned_cols=193 Identities=12% Similarity=0.149 Sum_probs=150.3
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
++-..|.|+.=+|... +.++|+.||.|++|....++.+..+....+..|+.+.|+..|+.+..+..||.+.
T Consensus 2206 ~~v~~v~r~~sHp~~~---------~Yltgs~dgsv~~~~w~~~~~v~~~rt~g~s~vtr~~f~~qGnk~~i~d~dg~l~ 2276 (2439)
T KOG1064|consen 2206 HPVENVRRMTSHPSDP---------YYLTGSQDGSVRMFEWGHGQQVVCFRTAGNSRVTRSRFNHQGNKFGIVDGDGDLS 2276 (2439)
T ss_pred cccCceeeecCCCCCc---------eEEecCCCceEEEEeccCCCeEEEeeccCcchhhhhhhcccCCceeeeccCCcee
Confidence 4456677777777777 8999999999999999888877777654558999999999999999999999999
Q ss_pred EEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc-----EEEEECCCC-ceeEEeecCCCCeEEEEECCCCCEEEE
Q 036605 99 EMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE-----VRILSLENG-EEVLKFSDDVGPLQYVSASDGAKIIIT 172 (340)
Q Consensus 99 ~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~-----i~i~d~~~~-~~~~~~~~~~~~v~~~~~s~~~~~l~s 172 (340)
+|.+. .++...++.|....+.+.|-. ..+++++.. +.+||.--. ..-..-..|.+.++++++.|..+.|++
T Consensus 2277 l~q~~-pk~~~s~qchnk~~~Df~Fi~--s~~~tag~s~d~~n~~lwDtl~~~~~s~v~~~H~~gaT~l~~~P~~qllis 2353 (2439)
T KOG1064|consen 2277 LWQAS-PKPYTSWQCHNKALSDFRFIG--SLLATAGRSSDNRNVCLWDTLLPPMNSLVHTCHDGGATVLAYAPKHQLLIS 2353 (2439)
T ss_pred ecccC-CcceeccccCCccccceeeee--hhhhccccCCCCCcccchhcccCcccceeeeecCCCceEEEEcCcceEEEe
Confidence 99987 566677888988888888876 455554332 999996322 111222789999999999999999999
Q ss_pred EEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 173 AGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 173 ~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
||. +|.|++||++ ..+....+. .+ . ...++++|+..|.++||++.....+.
T Consensus 2354 ggr-~G~v~l~D~r--qrql~h~~~--------------~~-~-~~~~f~~~ss~g~ikIw~~s~~~ll~ 2404 (2439)
T KOG1064|consen 2354 GGR-KGEVCLFDIR--QRQLRHTFQ--------------AL-D-TREYFVTGSSEGNIKIWRLSEFGLLH 2404 (2439)
T ss_pred cCC-cCcEEEeehH--HHHHHHHhh--------------hh-h-hhheeeccCcccceEEEEccccchhh
Confidence 888 9999999995 222222221 12 3 45679999999999999998876665
No 241
>KOG2111 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=99.30 E-value=1.4e-09 Score=87.47 Aligned_cols=176 Identities=9% Similarity=0.115 Sum_probs=123.9
Q ss_pred CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCC-CCeEEEEeec--CCCCeeEEEEccCCC
Q 036605 52 GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSE-MGEVIREFKA--SEKPISSSAFLCEEK 128 (340)
Q Consensus 52 g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~-~~~~~~~~~~--~~~~i~~l~~~~~~~ 128 (340)
..|.|||-...+.+..+. ...+|.++.+.++ .+++. ....|++|... +-+.++.+.. ......+++-+.+..
T Consensus 75 NkviIWDD~k~~~i~el~--f~~~I~~V~l~r~--riVvv-l~~~I~VytF~~n~k~l~~~et~~NPkGlC~~~~~~~k~ 149 (346)
T KOG2111|consen 75 NKVIIWDDLKERCIIELS--FNSEIKAVKLRRD--RIVVV-LENKIYVYTFPDNPKLLHVIETRSNPKGLCSLCPTSNKS 149 (346)
T ss_pred ceEEEEecccCcEEEEEE--eccceeeEEEcCC--eEEEE-ecCeEEEEEcCCChhheeeeecccCCCceEeecCCCCce
Confidence 579999966666776766 6779999999854 45543 45689999987 4444554432 233455554444445
Q ss_pred EEEEec---CcEEEEECCCCce--eEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCC
Q 036605 129 IFALAS---SEVRILSLENGEE--VLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHS 203 (340)
Q Consensus 129 ~l~~~~---~~i~i~d~~~~~~--~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~ 203 (340)
+|+.-+ |.|.|-|+...+. ...+.+|.+.|.+++++-+|..+++++...-.|+|||. .+++.+..+.-.. ..
T Consensus 150 ~LafPg~k~GqvQi~dL~~~~~~~p~~I~AH~s~Iacv~Ln~~Gt~vATaStkGTLIRIFdt--~~g~~l~E~RRG~-d~ 226 (346)
T KOG2111|consen 150 LLAFPGFKTGQVQIVDLASTKPNAPSIINAHDSDIACVALNLQGTLVATASTKGTLIRIFDT--EDGTLLQELRRGV-DR 226 (346)
T ss_pred EEEcCCCccceEEEEEhhhcCcCCceEEEcccCceeEEEEcCCccEEEEeccCcEEEEEEEc--CCCcEeeeeecCC-ch
Confidence 555533 3499999977654 46779999999999999999999998885556899998 5665554433111 11
Q ss_pred CeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 204 PVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 204 ~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
..+..+ .| +|+..+|+++|.-|+++||.+...
T Consensus 227 A~iy~i--aF-Sp~~s~LavsSdKgTlHiF~l~~~ 258 (346)
T KOG2111|consen 227 ADIYCI--AF-SPNSSWLAVSSDKGTLHIFSLRDT 258 (346)
T ss_pred heEEEE--Ee-CCCccEEEEEcCCCeEEEEEeecC
Confidence 223333 55 899999999999999999998763
No 242
>KOG0974 consensus WD-repeat protein WDR6, WD repeat superfamily [General function prediction only]
Probab=99.30 E-value=1.1e-10 Score=107.07 Aligned_cols=180 Identities=16% Similarity=0.073 Sum_probs=138.1
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCe-----EEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCe
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGL-----AGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPI 118 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v-----~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i 118 (340)
.++.++.+..+.+||...+.....+.. .... .-+-++++.-++++|+.-+.|.+|++...+.-..+.+|.+.|
T Consensus 101 ~i~l~~~~ns~~i~d~~~~~~~~~i~~--~er~~l~~~~~~g~s~~~~~i~~gsv~~~iivW~~~~dn~p~~l~GHeG~i 178 (967)
T KOG0974|consen 101 KIALVTSRNSLLIRDSKNSSVLSKIQS--DERCTLYSSLIIGDSAEELYIASGSVFGEIIVWKPHEDNKPIRLKGHEGSI 178 (967)
T ss_pred eEEEEEcCceEEEEecccCceehhcCC--CceEEEEeEEEEeccCcEEEEEeccccccEEEEeccccCCcceecccCCce
Confidence 788899999999999998877766653 3222 122345556688888899999999987444334588999999
Q ss_pred eEEEEccCCCEEEEecCc--EEEEECCCCceeE-EeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCC
Q 036605 119 SSSAFLCEEKIFALASSE--VRILSLENGEEVL-KFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKG 195 (340)
Q Consensus 119 ~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~-~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~ 195 (340)
.++.++-||+++++.+.+ +++|++.+.+... ..-+|...+..+.|.|+ ++++++. |.+.++|+. .+.+...
T Consensus 179 F~i~~s~dg~~i~s~SdDRsiRlW~i~s~~~~~~~~fgHsaRvw~~~~~~n--~i~t~ge-dctcrvW~~---~~~~l~~ 252 (967)
T KOG0974|consen 179 FSIVTSLDGRYIASVSDDRSIRLWPIDSREVLGCTGFGHSARVWACCFLPN--RIITVGE-DCTCRVWGV---NGTQLEV 252 (967)
T ss_pred EEEEEccCCcEEEEEecCcceeeeecccccccCcccccccceeEEEEeccc--eeEEecc-ceEEEEEec---ccceehh
Confidence 999999999999885544 9999999987775 55689999999999998 8999888 999999986 3333334
Q ss_pred ceeeecCCCe-eeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 196 PALSMRHSPV-AIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 196 ~~~~~~~~~~-~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
+. +|... +..+ .. +++...+++++.||.+++|++..
T Consensus 253 y~---~h~g~~iw~~--~~-~~~~~~~vT~g~Ds~lk~~~l~~ 289 (967)
T KOG0974|consen 253 YD---EHSGKGIWKI--AV-PIGVIIKVTGGNDSTLKLWDLNG 289 (967)
T ss_pred hh---hhhhcceeEE--EE-cCCceEEEeeccCcchhhhhhhc
Confidence 43 33322 2222 22 67778899999999999999876
No 243
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=99.29 E-value=9.3e-10 Score=98.32 Aligned_cols=174 Identities=15% Similarity=0.081 Sum_probs=116.3
Q ss_pred CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCC---CcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCC
Q 036605 52 GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTN---GMASEMKSEMGEVIREFKASEKPISSSAFLCEEK 128 (340)
Q Consensus 52 g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~d---g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~ 128 (340)
..|.++|...+. ...+.. +...+...+|+|||+.|+.+..+ ..|++||+.+++... +..+...+.+++|+|+|+
T Consensus 170 ~~l~~~d~~g~~-~~~l~~-~~~~~~~p~~Spdg~~la~~~~~~~~~~i~v~d~~~g~~~~-~~~~~~~~~~~~~spDg~ 246 (417)
T TIGR02800 170 YELQVADYDGAN-PQTITR-SREPILSPAWSPDGQKLAYVSFESGKPEIYVQDLATGQREK-VASFPGMNGAPAFSPDGS 246 (417)
T ss_pred ceEEEEcCCCCC-CEEeec-CCCceecccCCCCCCEEEEEEcCCCCcEEEEEECCCCCEEE-eecCCCCccceEECCCCC
Confidence 368888876443 445555 66678999999999999887654 479999999886543 333445567789999998
Q ss_pred EEEE-ec----CcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCe--EEEEEccCCCCCccCCceeeec
Q 036605 129 IFAL-AS----SEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKH--LQVWRCDISSKTVNKGPALSMR 201 (340)
Q Consensus 129 ~l~~-~~----~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~--i~iwd~~~~~~~~~~~~~~~~~ 201 (340)
.|+. .+ .+|++||+.++.. ..+..+........|+|+|++|+..+..++. |.++++ ..++. ..+. .
T Consensus 247 ~l~~~~~~~~~~~i~~~d~~~~~~-~~l~~~~~~~~~~~~s~dg~~l~~~s~~~g~~~iy~~d~--~~~~~-~~l~---~ 319 (417)
T TIGR02800 247 KLAVSLSKDGNPDIYVMDLDGKQL-TRLTNGPGIDTEPSWSPDGKSIAFTSDRGGSPQIYMMDA--DGGEV-RRLT---F 319 (417)
T ss_pred EEEEEECCCCCccEEEEECCCCCE-EECCCCCCCCCCEEECCCCCEEEEEECCCCCceEEEEEC--CCCCE-EEee---c
Confidence 7764 22 2399999988743 4444455555678999999998876654444 555555 33322 1111 1
Q ss_pred CCCeeeeeecCCCCCCCCEEEEEeCCC---cEEEEECCCC
Q 036605 202 HSPVAIDCKNSPNGEDGTVILAVAESG---VAYSWDLKTV 238 (340)
Q Consensus 202 ~~~~~~~~~~~~~~~~~~~l~~~s~dg---~i~vwd~~~~ 238 (340)
+....... .| ++++.+++.++.++ .|++||+.++
T Consensus 320 ~~~~~~~~--~~-spdg~~i~~~~~~~~~~~i~~~d~~~~ 356 (417)
T TIGR02800 320 RGGYNASP--SW-SPDGDLIAFVHREGGGFNIAVMDLDGG 356 (417)
T ss_pred CCCCccCe--EE-CCCCCEEEEEEccCCceEEEEEeCCCC
Confidence 11111122 34 88999999888776 7889998764
No 244
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=99.26 E-value=1.1e-08 Score=88.56 Aligned_cols=200 Identities=15% Similarity=0.143 Sum_probs=129.9
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcC----CCcEEEEEccCC--ee--EEEecCCCCCCeEEEEEecCCCEEEEEeC
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTS----NGDILAVDVLTG--EM--KWKSTGRHPGGLAGLAFAKKGRSLHVVGT 93 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~----dg~i~i~d~~~~--~~--~~~~~~~h~~~v~~v~~~~~~~~l~s~~~ 93 (340)
...+.|+++|+++ +|++... +|.|..|.+... ++ +.+... .......++++|++++|+++..
T Consensus 37 ~~Ps~l~~~~~~~---------~LY~~~e~~~~~g~v~~~~i~~~~g~L~~~~~~~~-~g~~p~~i~~~~~g~~l~vany 106 (345)
T PF10282_consen 37 ENPSWLAVSPDGR---------RLYVVNEGSGDSGGVSSYRIDPDTGTLTLLNSVPS-GGSSPCHIAVDPDGRFLYVANY 106 (345)
T ss_dssp SSECCEEE-TTSS---------EEEEEETTSSTTTEEEEEEEETTTTEEEEEEEEEE-SSSCEEEEEECTTSSEEEEEET
T ss_pred CCCceEEEEeCCC---------EEEEEEccccCCCCEEEEEECCCcceeEEeeeecc-CCCCcEEEEEecCCCEEEEEEc
Confidence 4566788999998 7777665 579999988764 32 222321 2345678999999999999874
Q ss_pred -CCcEEEEeCCC-CeEEEE---ee----------cCCCCeeEEEEccCCCEEEEe---cCcEEEEECCCCce-e---EEe
Q 036605 94 -NGMASEMKSEM-GEVIRE---FK----------ASEKPISSSAFLCEEKIFALA---SSEVRILSLENGEE-V---LKF 151 (340)
Q Consensus 94 -dg~i~~wd~~~-~~~~~~---~~----------~~~~~i~~l~~~~~~~~l~~~---~~~i~i~d~~~~~~-~---~~~ 151 (340)
+|.|.++++.. |..... +. ......+++.++|+++++++. ...|++|++..... + ..+
T Consensus 107 ~~g~v~v~~l~~~g~l~~~~~~~~~~g~g~~~~rq~~~h~H~v~~~pdg~~v~v~dlG~D~v~~~~~~~~~~~l~~~~~~ 186 (345)
T PF10282_consen 107 GGGSVSVFPLDDDGSLGEVVQTVRHEGSGPNPDRQEGPHPHQVVFSPDGRFVYVPDLGADRVYVYDIDDDTGKLTPVDSI 186 (345)
T ss_dssp TTTEEEEEEECTTSEEEEEEEEEESEEEESSTTTTSSTCEEEEEE-TTSSEEEEEETTTTEEEEEEE-TTS-TEEEEEEE
T ss_pred cCCeEEEEEccCCcccceeeeecccCCCCCcccccccccceeEEECCCCCEEEEEecCCCEEEEEEEeCCCceEEEeecc
Confidence 79999999986 443322 21 122457899999999998773 33499999876541 2 222
Q ss_pred e-cCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeee---cC----CCeeeeeecCCCCCCCCEEEE
Q 036605 152 S-DDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSM---RH----SPVAIDCKNSPNGEDGTVILA 223 (340)
Q Consensus 152 ~-~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~---~~----~~~~~~~~~~~~~~~~~~l~~ 223 (340)
. ......+.+.|+|++++++.....++.|.+|+++...+.......... .. .+..+.+ +|+|++|++
T Consensus 187 ~~~~G~GPRh~~f~pdg~~~Yv~~e~s~~v~v~~~~~~~g~~~~~~~~~~~~~~~~~~~~~~~i~i-----spdg~~lyv 261 (345)
T PF10282_consen 187 KVPPGSGPRHLAFSPDGKYAYVVNELSNTVSVFDYDPSDGSLTEIQTISTLPEGFTGENAPAEIAI-----SPDGRFLYV 261 (345)
T ss_dssp ECSTTSSEEEEEE-TTSSEEEEEETTTTEEEEEEEETTTTEEEEEEEEESCETTSCSSSSEEEEEE------TTSSEEEE
T ss_pred ccccCCCCcEEEEcCCcCEEEEecCCCCcEEEEeecccCCceeEEEEeeeccccccccCCceeEEE-----ecCCCEEEE
Confidence 2 233567899999999999998888999999999532332111111110 11 1222333 899999877
Q ss_pred Ee-CCCcEEEEECC
Q 036605 224 VA-ESGVAYSWDLK 236 (340)
Q Consensus 224 ~s-~dg~i~vwd~~ 236 (340)
+. ..+.|.+|++.
T Consensus 262 snr~~~sI~vf~~d 275 (345)
T PF10282_consen 262 SNRGSNSISVFDLD 275 (345)
T ss_dssp EECTTTEEEEEEEC
T ss_pred EeccCCEEEEEEEe
Confidence 66 45679999984
No 245
>KOG2315 consensus Predicted translation initiation factor related to eIF-3a [Translation, ribosomal structure and biogenesis]
Probab=99.26 E-value=1.4e-09 Score=93.66 Aligned_cols=206 Identities=16% Similarity=0.195 Sum_probs=131.0
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeE-EEecCCCCCCeEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMK-WKSTGRHPGGLAGL 79 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~-~~~~~~h~~~v~~v 79 (340)
||+++++.....|... .... +++.|++|.. |++--..+.+++|+..+.+.. +.+ |...|+.+
T Consensus 109 v~~vet~~~~s~~q~k---~Q~~-W~~qfs~dEs----------l~arlv~nev~f~~~~~f~~~~~kl---~~~~i~~f 171 (566)
T KOG2315|consen 109 VYNVETGVQRSQIQKK---MQNG-WVPQFSIDES----------LAARLVSNEVQFYDLGSFKTIQHKL---SVSGITML 171 (566)
T ss_pred eeeeccceehhheehh---hhcC-cccccccchh----------hhhhhhcceEEEEecCCccceeeee---eccceeeE
Confidence 5777776555555522 1122 6889999887 555556678999987664322 222 45567777
Q ss_pred EEecCCC--EEEE-----EeCCCcEEEEeCC-------------------------------------------------
Q 036605 80 AFAKKGR--SLHV-----VGTNGMASEMKSE------------------------------------------------- 103 (340)
Q Consensus 80 ~~~~~~~--~l~s-----~~~dg~i~~wd~~------------------------------------------------- 103 (340)
.++|.+. .+++ .|.-..|++|...
T Consensus 172 ~lSpgp~~~~vAvyvPe~kGaPa~vri~~~~~~~~~~~~a~ksFFkadkvqm~WN~~gt~LLvLastdVDktn~SYYGEq 251 (566)
T KOG2315|consen 172 SLSPGPEPPFVAVYVPEKKGAPASVRIYKYPEEGQHQPVANKSFFKADKVQMKWNKLGTALLVLASTDVDKTNASYYGEQ 251 (566)
T ss_pred EecCCCCCceEEEEccCCCCCCcEEEEeccccccccchhhhccccccceeEEEeccCCceEEEEEEEeecCCCccccccc
Confidence 7776522 2222 1222345555432
Q ss_pred --------CCeEEEEeecCCCCeeEEEEccCCCEEEEecCc----EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEE
Q 036605 104 --------MGEVIREFKASEKPISSSAFLCEEKIFALASSE----VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIII 171 (340)
Q Consensus 104 --------~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~----i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~ 171 (340)
.......+ ...++|+++.|+|+++.+++.-|- +.|||++.. .+..| ..++-+.+-|+|.|++|+
T Consensus 252 ~Lyll~t~g~s~~V~L-~k~GPVhdv~W~~s~~EF~VvyGfMPAkvtifnlr~~-~v~df--~egpRN~~~fnp~g~ii~ 327 (566)
T KOG2315|consen 252 TLYLLATQGESVSVPL-LKEGPVHDVTWSPSGREFAVVYGFMPAKVTIFNLRGK-PVFDF--PEGPRNTAFFNPHGNIIL 327 (566)
T ss_pred eEEEEEecCceEEEec-CCCCCceEEEECCCCCEEEEEEecccceEEEEcCCCC-EeEeC--CCCCccceEECCCCCEEE
Confidence 00111111 136789999999999988774443 999998755 55555 356778899999999999
Q ss_pred EEEcC--CCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeC------CCcEEEEECCC
Q 036605 172 TAGYG--EKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAE------SGVAYSWDLKT 237 (340)
Q Consensus 172 s~~~~--d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~------dg~i~vwd~~~ 237 (340)
.+|.+ -|.|-|||+ ...+++..+. ...... +.| +|||.++++++. |+.++||+...
T Consensus 328 lAGFGNL~G~mEvwDv--~n~K~i~~~~---a~~tt~----~eW-~PdGe~flTATTaPRlrvdNg~KiwhytG 391 (566)
T KOG2315|consen 328 LAGFGNLPGDMEVWDV--PNRKLIAKFK---AANTTV----FEW-SPDGEYFLTATTAPRLRVDNGIKIWHYTG 391 (566)
T ss_pred EeecCCCCCceEEEec--cchhhccccc---cCCceE----EEE-cCCCcEEEEEeccccEEecCCeEEEEecC
Confidence 99885 488999999 4555444443 222222 244 999999999875 56689998754
No 246
>PRK00178 tolB translocation protein TolB; Provisional
Probab=99.25 E-value=3.2e-09 Score=95.13 Aligned_cols=176 Identities=10% Similarity=0.079 Sum_probs=114.4
Q ss_pred cEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCC---CcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCE
Q 036605 53 DILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTN---GMASEMKSEMGEVIREFKASEKPISSSAFLCEEKI 129 (340)
Q Consensus 53 ~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~d---g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~ 129 (340)
.|.++|...+.. ..+.. +...+...+|+|||+.|+..+.+ ..|.+||+.+++... +...........|+|||+.
T Consensus 180 ~l~~~d~~g~~~-~~l~~-~~~~~~~p~wSpDG~~la~~s~~~~~~~l~~~~l~~g~~~~-l~~~~g~~~~~~~SpDG~~ 256 (430)
T PRK00178 180 TLQRSDYDGARA-VTLLQ-SREPILSPRWSPDGKRIAYVSFEQKRPRIFVQNLDTGRREQ-ITNFEGLNGAPAWSPDGSK 256 (430)
T ss_pred EEEEECCCCCCc-eEEec-CCCceeeeeECCCCCEEEEEEcCCCCCEEEEEECCCCCEEE-ccCCCCCcCCeEECCCCCE
Confidence 477888775543 44444 66788999999999998776643 468999999887543 3333344567899999998
Q ss_pred EEE-e--cC--cEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCC
Q 036605 130 FAL-A--SS--EVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSP 204 (340)
Q Consensus 130 l~~-~--~~--~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~ 204 (340)
++. . ++ +|++||+.+++. ..+..+........|+|||+.|+..+..++...||.++..+++. ..+... ....
T Consensus 257 la~~~~~~g~~~Iy~~d~~~~~~-~~lt~~~~~~~~~~~spDg~~i~f~s~~~g~~~iy~~d~~~g~~-~~lt~~-~~~~ 333 (430)
T PRK00178 257 LAFVLSKDGNPEIYVMDLASRQL-SRVTNHPAIDTEPFWGKDGRTLYFTSDRGGKPQIYKVNVNGGRA-ERVTFV-GNYN 333 (430)
T ss_pred EEEEEccCCCceEEEEECCCCCe-EEcccCCCCcCCeEECCCCCEEEEEECCCCCceEEEEECCCCCE-EEeecC-CCCc
Confidence 864 2 22 399999998754 44555555667789999999888766645544444433244432 111110 1111
Q ss_pred eeeeeecCCCCCCCCEEEEEeCC-C--cEEEEECCCCC
Q 036605 205 VAIDCKNSPNGEDGTVILAVAES-G--VAYSWDLKTVS 239 (340)
Q Consensus 205 ~~~~~~~~~~~~~~~~l~~~s~d-g--~i~vwd~~~~~ 239 (340)
.. ..| +|+|.+++..+.+ + .|++||+.+++
T Consensus 334 ~~----~~~-Spdg~~i~~~~~~~~~~~l~~~dl~tg~ 366 (430)
T PRK00178 334 AR----PRL-SADGKTLVMVHRQDGNFHVAAQDLQRGS 366 (430)
T ss_pred cc----eEE-CCCCCEEEEEEccCCceEEEEEECCCCC
Confidence 11 134 7899998877654 3 47888987754
No 247
>PRK04792 tolB translocation protein TolB; Provisional
Probab=99.25 E-value=2.6e-09 Score=95.61 Aligned_cols=176 Identities=16% Similarity=0.117 Sum_probs=112.4
Q ss_pred cEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCC---CcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCE
Q 036605 53 DILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTN---GMASEMKSEMGEVIREFKASEKPISSSAFLCEEKI 129 (340)
Q Consensus 53 ~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~d---g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~ 129 (340)
.|.++|...... ..+.. +...+....|+|||+.|+..+.+ ..|.+||+.+++.... ..........+|+|||+.
T Consensus 199 ~l~i~d~dG~~~-~~l~~-~~~~~~~p~wSPDG~~La~~s~~~g~~~L~~~dl~tg~~~~l-t~~~g~~~~~~wSPDG~~ 275 (448)
T PRK04792 199 QLMIADYDGYNE-QMLLR-SPEPLMSPAWSPDGRKLAYVSFENRKAEIFVQDIYTQVREKV-TSFPGINGAPRFSPDGKK 275 (448)
T ss_pred EEEEEeCCCCCc-eEeec-CCCcccCceECCCCCEEEEEEecCCCcEEEEEECCCCCeEEe-cCCCCCcCCeeECCCCCE
Confidence 677778655443 34444 67789999999999988876543 3588999988875332 222334457899999998
Q ss_pred EEEe---cC--cEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCC
Q 036605 130 FALA---SS--EVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSP 204 (340)
Q Consensus 130 l~~~---~~--~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~ 204 (340)
|+.. ++ +|+++|+.+++. ..+..+........|+|||++|+..+..++...||.++..+++.. .+.+ . ..
T Consensus 276 La~~~~~~g~~~Iy~~dl~tg~~-~~lt~~~~~~~~p~wSpDG~~I~f~s~~~g~~~Iy~~dl~~g~~~-~Lt~--~-g~ 350 (448)
T PRK04792 276 LALVLSKDGQPEIYVVDIATKAL-TRITRHRAIDTEPSWHPDGKSLIFTSERGGKPQIYRVNLASGKVS-RLTF--E-GE 350 (448)
T ss_pred EEEEEeCCCCeEEEEEECCCCCe-EECccCCCCccceEECCCCCEEEEEECCCCCceEEEEECCCCCEE-EEec--C-CC
Confidence 8652 22 299999988754 455555556678899999999888776555555555443444321 1111 1 11
Q ss_pred eeeeeecCCCCCCCCEEEEEeCC-C--cEEEEECCCCC
Q 036605 205 VAIDCKNSPNGEDGTVILAVAES-G--VAYSWDLKTVS 239 (340)
Q Consensus 205 ~~~~~~~~~~~~~~~~l~~~s~d-g--~i~vwd~~~~~ 239 (340)
.... ..| +|+|.+++..+.+ + .|.++|+.++.
T Consensus 351 ~~~~--~~~-SpDG~~l~~~~~~~g~~~I~~~dl~~g~ 385 (448)
T PRK04792 351 QNLG--GSI-TPDGRSMIMVNRTNGKFNIARQDLETGA 385 (448)
T ss_pred CCcC--eeE-CCCCCEEEEEEecCCceEEEEEECCCCC
Confidence 1111 144 8999888776553 3 45556766653
No 248
>KOG1240 consensus Protein kinase containing WD40 repeats [Signal transduction mechanisms]
Probab=99.23 E-value=2e-09 Score=100.74 Aligned_cols=210 Identities=11% Similarity=0.085 Sum_probs=139.7
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe-------eEEEecCCCCCCeEEE-EEec-CCC-EEE
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE-------MKWKSTGRHPGGLAGL-AFAK-KGR-SLH 89 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~-------~~~~~~~~h~~~v~~v-~~~~-~~~-~l~ 89 (340)
...++.++.+.+.+. .+|+|+.||.|++.++...+ ..........+.+..+ +|.. .+. .|+
T Consensus 1097 ~~sr~~~vt~~~~~~---------~~Av~t~DG~v~~~~id~~~~~~~~~~~~ri~n~~~~g~vv~m~a~~~~~~S~~lv 1167 (1431)
T KOG1240|consen 1097 EGSRVEKVTMCGNGD---------QFAVSTKDGSVRVLRIDHYNVSKRVATQVRIPNLKKDGVVVSMHAFTAIVQSHVLV 1167 (1431)
T ss_pred cCCceEEEEeccCCC---------eEEEEcCCCeEEEEEccccccccceeeeeecccccCCCceEEeecccccccceeEE
Confidence 457889999999888 89999999999999887621 1111122123334333 3433 233 577
Q ss_pred EEeCCCcEEEEeCCCCeEEEEee--cCCCCeeEEEEccCCCEEEEecC--cEEEEECCCCceeEEe-ecCCCCeEEEEEC
Q 036605 90 VVGTNGMASEMKSEMGEVIREFK--ASEKPISSSAFLCEEKIFALASS--EVRILSLENGEEVLKF-SDDVGPLQYVSAS 164 (340)
Q Consensus 90 s~~~dg~i~~wd~~~~~~~~~~~--~~~~~i~~l~~~~~~~~l~~~~~--~i~i~d~~~~~~~~~~-~~~~~~v~~~~~s 164 (340)
.+..-+.|..||++.......++ ...+.|++++++|.+.+++.|.. .+.+||++-+.++..+ ..+..++..+..+
T Consensus 1168 y~T~~~~iv~~D~r~~~~~w~lk~~~~hG~vTSi~idp~~~WlviGts~G~l~lWDLRF~~~i~sw~~P~~~~i~~v~~~ 1247 (1431)
T KOG1240|consen 1168 YATDLSRIVSWDTRMRHDAWRLKNQLRHGLVTSIVIDPWCNWLVIGTSRGQLVLWDLRFRVPILSWEHPARAPIRHVWLC 1247 (1431)
T ss_pred EEEeccceEEecchhhhhHHhhhcCccccceeEEEecCCceEEEEecCCceEEEEEeecCceeecccCcccCCcceEEee
Confidence 77788999999998776555443 34567999999999999988654 4999999999888777 3345788888776
Q ss_pred CC---CCEEEEEEc-CCCeEEEEEccCCCCCccCCceee---------ecC-----CCeeeeeecCCCCCCCCEEEEEeC
Q 036605 165 DG---AKIIITAGY-GEKHLQVWRCDISSKTVNKGPALS---------MRH-----SPVAIDCKNSPNGEDGTVILAVAE 226 (340)
Q Consensus 165 ~~---~~~l~s~~~-~d~~i~iwd~~~~~~~~~~~~~~~---------~~~-----~~~~~~~~~~~~~~~~~~l~~~s~ 226 (340)
|- ....++++. ..+.|.+|++ .++.....+... ... +.......|+. ...+.++++|+.
T Consensus 1248 ~~~~~~S~~vs~~~~~~nevs~wn~--~~g~~~~vl~~s~~~p~ls~~~Ps~~~~kp~~~~~~~~~~-~~~~~~~ltggs 1324 (1431)
T KOG1240|consen 1248 PTYPQESVSVSAGSSSNNEVSTWNM--ETGLRQTVLWASDGAPILSYALPSNDARKPDSLAGISCGV-CEKNGFLLTGGS 1324 (1431)
T ss_pred ccCCCCceEEEecccCCCceeeeec--ccCcceEEEEcCCCCcchhhhcccccCCCCCcccceeeec-ccCCceeeecCC
Confidence 54 346666666 6889999998 444221111110 001 11122222333 445667899999
Q ss_pred CCcEEEEECCCCCcc
Q 036605 227 SGVAYSWDLKTVSQD 241 (340)
Q Consensus 227 dg~i~vwd~~~~~~~ 241 (340)
|..|+.||....+..
T Consensus 1325 d~kIR~wD~~~p~~s 1339 (1431)
T KOG1240|consen 1325 DMKIRKWDPTRPEIS 1339 (1431)
T ss_pred ccceeeccCCCcccc
Confidence 999999998775544
No 249
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=99.22 E-value=3.2e-08 Score=84.14 Aligned_cols=219 Identities=12% Similarity=0.100 Sum_probs=140.6
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEc----------CCCcEEEEEccCCeeEEEecC
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGT----------SNGDILAVDVLTGEMKWKSTG 70 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~----------~dg~i~i~d~~~~~~~~~~~~ 70 (340)
|.|..+++++.++... ..+- .+ +|||++ .|+++. .+..|.+||+.+.+.+..+.-
T Consensus 31 ViD~~~~~v~g~i~~G----~~P~-~~-~spDg~---------~lyva~~~~~R~~~G~~~d~V~v~D~~t~~~~~~i~~ 95 (352)
T TIGR02658 31 TIDGEAGRVLGMTDGG----FLPN-PV-VASDGS---------FFAHASTVYSRIARGKRTDYVEVIDPQTHLPIADIEL 95 (352)
T ss_pred EEECCCCEEEEEEEcc----CCCc-ee-ECCCCC---------EEEEEeccccccccCCCCCEEEEEECccCcEEeEEcc
Confidence 3577778888777622 2222 24 999997 555554 478999999999998888763
Q ss_pred CC------CCCeEEEEEecCCCEEEEEe-C-CCcEEEEeCCCCeEEEEeecCCC--------------------------
Q 036605 71 RH------PGGLAGLAFAKKGRSLHVVG-T-NGMASEMKSEMGEVIREFKASEK-------------------------- 116 (340)
Q Consensus 71 ~h------~~~v~~v~~~~~~~~l~s~~-~-dg~i~~wd~~~~~~~~~~~~~~~-------------------------- 116 (340)
.- ......++++|||++|+... . +..|.+.|+.+++.+.++.-...
T Consensus 96 p~~p~~~~~~~~~~~~ls~dgk~l~V~n~~p~~~V~VvD~~~~kvv~ei~vp~~~~vy~t~e~~~~~~~~Dg~~~~v~~d 175 (352)
T TIGR02658 96 PEGPRFLVGTYPWMTSLTPDNKTLLFYQFSPSPAVGVVDLEGKAFVRMMDVPDCYHIFPTANDTFFMHCRDGSLAKVGYG 175 (352)
T ss_pred CCCchhhccCccceEEECCCCCEEEEecCCCCCEEEEEECCCCcEEEEEeCCCCcEEEEecCCccEEEeecCceEEEEec
Confidence 11 11234789999999999876 3 68999999998876654321100
Q ss_pred -----CeeEE--------------EEcc-CCCEE-EEecCcEEEEECCCCc-----eeEEee-------cCCCCeEEEEE
Q 036605 117 -----PISSS--------------AFLC-EEKIF-ALASSEVRILSLENGE-----EVLKFS-------DDVGPLQYVSA 163 (340)
Q Consensus 117 -----~i~~l--------------~~~~-~~~~l-~~~~~~i~i~d~~~~~-----~~~~~~-------~~~~~v~~~~~ 163 (340)
..... .+.+ +|+++ ++..+.|.+.|+.... ....+. -..+.+.-+++
T Consensus 176 ~~g~~~~~~~~vf~~~~~~v~~rP~~~~~dg~~~~vs~eG~V~~id~~~~~~~~~~~~~~~~~~~~~~~wrP~g~q~ia~ 255 (352)
T TIGR02658 176 TKGNPKIKPTEVFHPEDEYLINHPAYSNKSGRLVWPTYTGKIFQIDLSSGDAKFLPAIEAFTEAEKADGWRPGGWQQVAY 255 (352)
T ss_pred CCCceEEeeeeeecCCccccccCCceEcCCCcEEEEecCCeEEEEecCCCcceecceeeeccccccccccCCCcceeEEE
Confidence 00010 1122 55555 3345668888854332 222221 12334455999
Q ss_pred CCCCCEEEEEEc---------CCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCC-EEEEEe-CCCcEEE
Q 036605 164 SDGAKIIITAGY---------GEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGT-VILAVA-ESGVAYS 232 (340)
Q Consensus 164 s~~~~~l~s~~~---------~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~l~~~s-~dg~i~v 232 (340)
+++++.++.... ..+.|.++|. .+++....+ ..++.++.+.+ ++|+. +|++.. .++.|.+
T Consensus 256 ~~dg~~lyV~~~~~~~~thk~~~~~V~ViD~--~t~kvi~~i--~vG~~~~~iav-----S~Dgkp~lyvtn~~s~~VsV 326 (352)
T TIGR02658 256 HRARDRIYLLADQRAKWTHKTASRFLFVVDA--KTGKRLRKI--ELGHEIDSINV-----SQDAKPLLYALSTGDKTLYI 326 (352)
T ss_pred cCCCCEEEEEecCCccccccCCCCEEEEEEC--CCCeEEEEE--eCCCceeeEEE-----CCCCCeEEEEeCCCCCcEEE
Confidence 999998888432 1257888887 555544333 34666667766 89999 777666 5788999
Q ss_pred EECCCCCccCC
Q 036605 233 WDLKTVSQDEK 243 (340)
Q Consensus 233 wd~~~~~~~~~ 243 (340)
+|..+++.+..
T Consensus 327 iD~~t~k~i~~ 337 (352)
T TIGR02658 327 FDAETGKELSS 337 (352)
T ss_pred EECcCCeEEee
Confidence 99999877763
No 250
>PRK01029 tolB translocation protein TolB; Provisional
Probab=99.22 E-value=2.1e-09 Score=95.54 Aligned_cols=154 Identities=17% Similarity=0.159 Sum_probs=97.1
Q ss_pred CCeEEEEeeccccccccccCceEEEEEc-CCC--cE--EEEEccCC--eeEEEecCCCCCCeEEEEEecCCCEEEEEe-C
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGT-SNG--DI--LAVDVLTG--EMKWKSTGRHPGGLAGLAFAKKGRSLHVVG-T 93 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~-~dg--~i--~i~d~~~~--~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~-~ 93 (340)
......+|||||+ .|+..+ .+| .+ .+|++..+ .....+...+.+.....+|+|||+.|+..+ .
T Consensus 231 g~~~~p~wSPDG~---------~Laf~s~~~g~~di~~~~~~~~~g~~g~~~~lt~~~~~~~~~p~wSPDG~~Laf~s~~ 301 (428)
T PRK01029 231 GNQLMPTFSPRKK---------LLAFISDRYGNPDLFIQSFSLETGAIGKPRRLLNEAFGTQGNPSFSPDGTRLVFVSNK 301 (428)
T ss_pred CCccceEECCCCC---------EEEEEECCCCCcceeEEEeecccCCCCcceEeecCCCCCcCCeEECCCCCEEEEEECC
Confidence 3445689999997 566543 233 33 44676653 122333321334456789999999877665 4
Q ss_pred CCc--EEEEeCCC-CeEEEEeecCCCCeeEEEEccCCCEEEEec-----CcEEEEECCCCceeEEeecCCCCeEEEEECC
Q 036605 94 NGM--ASEMKSEM-GEVIREFKASEKPISSSAFLCEEKIFALAS-----SEVRILSLENGEEVLKFSDDVGPLQYVSASD 165 (340)
Q Consensus 94 dg~--i~~wd~~~-~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~-----~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~ 165 (340)
+|. |.++++.. +.....+..+...+....|+|||+.|+... ..|++||+.+++. ..+......+....|+|
T Consensus 302 ~g~~~ly~~~~~~~g~~~~~lt~~~~~~~~p~wSPDG~~Laf~~~~~g~~~I~v~dl~~g~~-~~Lt~~~~~~~~p~wSp 380 (428)
T PRK01029 302 DGRPRIYIMQIDPEGQSPRLLTKKYRNSSCPAWSPDGKKIAFCSVIKGVRQICVYDLATGRD-YQLTTSPENKESPSWAI 380 (428)
T ss_pred CCCceEEEEECcccccceEEeccCCCCccceeECCCCCEEEEEEcCCCCcEEEEEECCCCCe-EEccCCCCCccceEECC
Confidence 564 44445532 223344544455677899999999887632 2399999998865 34433344567899999
Q ss_pred CCCEEEEEEcCC--CeEEEEEc
Q 036605 166 GAKIIITAGYGE--KHLQVWRC 185 (340)
Q Consensus 166 ~~~~l~s~~~~d--~~i~iwd~ 185 (340)
||++|+..+... ..|.++++
T Consensus 381 DG~~L~f~~~~~g~~~L~~vdl 402 (428)
T PRK01029 381 DSLHLVYSAGNSNESELYLISL 402 (428)
T ss_pred CCCEEEEEECCCCCceEEEEEC
Confidence 999888655433 45666776
No 251
>PRK04043 tolB translocation protein TolB; Provisional
Probab=99.21 E-value=1.9e-08 Score=88.90 Aligned_cols=190 Identities=12% Similarity=0.047 Sum_probs=118.2
Q ss_pred CeEEEEeeccccccccccCceE-EEEEcC---CCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEE-eC--CC
Q 036605 23 SYSCLACGFVGKKRRKERGTLL-LALGTS---NGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVV-GT--NG 95 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~-l~~g~~---dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~-~~--dg 95 (340)
......|+|||+ . ++..+. +..|+++|+.+++... +.. ..+......|+|||+.|+.. +. +.
T Consensus 189 ~~~~p~wSpDG~---------~~i~y~s~~~~~~~Iyv~dl~tg~~~~-lt~-~~g~~~~~~~SPDG~~la~~~~~~g~~ 257 (419)
T PRK04043 189 LNIFPKWANKEQ---------TAFYYTSYGERKPTLYKYNLYTGKKEK-IAS-SQGMLVVSDVSKDGSKLLLTMAPKGQP 257 (419)
T ss_pred CeEeEEECCCCC---------cEEEEEEccCCCCEEEEEECCCCcEEE-Eec-CCCcEEeeEECCCCCEEEEEEccCCCc
Confidence 667899999996 3 554333 3579999998886443 333 55667788999999876653 33 35
Q ss_pred cEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE-ecC----cEEEEECCCCceeEEeecCCCCeEEEEECCCCCEE
Q 036605 96 MASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL-ASS----EVRILSLENGEEVLKFSDDVGPLQYVSASDGAKII 170 (340)
Q Consensus 96 ~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~-~~~----~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l 170 (340)
.|.++|+.++.. ..+..+........|+|||+.++. .++ +|+++|+.+++..+... ... ....|+|||++|
T Consensus 258 ~Iy~~dl~~g~~-~~LT~~~~~d~~p~~SPDG~~I~F~Sdr~g~~~Iy~~dl~~g~~~rlt~-~g~--~~~~~SPDG~~I 333 (419)
T PRK04043 258 DIYLYDTNTKTL-TQITNYPGIDVNGNFVEDDKRIVFVSDRLGYPNIFMKKLNSGSVEQVVF-HGK--NNSSVSTYKNYI 333 (419)
T ss_pred EEEEEECCCCcE-EEcccCCCccCccEECCCCCEEEEEECCCCCceEEEEECCCCCeEeCcc-CCC--cCceECCCCCEE
Confidence 788889888764 344444433445689999987755 333 39999998876533222 111 124899999999
Q ss_pred EEEEcCC--------CeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCC---cEEEEECCC
Q 036605 171 ITAGYGE--------KHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESG---VAYSWDLKT 237 (340)
Q Consensus 171 ~s~~~~d--------~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg---~i~vwd~~~ 237 (340)
+...... ..|.+.|+ .++.. ..+. .. .. .....| +|||..++..+.++ .+.+.++..
T Consensus 334 a~~~~~~~~~~~~~~~~I~v~d~--~~g~~-~~LT--~~--~~--~~~p~~-SPDG~~I~f~~~~~~~~~L~~~~l~g 401 (419)
T PRK04043 334 VYSSRETNNEFGKNTFNLYLIST--NSDYI-RRLT--AN--GV--NQFPRF-SSDGGSIMFIKYLGNQSALGIIRLNY 401 (419)
T ss_pred EEEEcCCCcccCCCCcEEEEEEC--CCCCe-EECC--CC--CC--cCCeEE-CCCCCEEEEEEccCCcEEEEEEecCC
Confidence 8876633 25666666 44432 1121 01 11 111245 89999887766543 245555543
No 252
>KOG1354 consensus Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=99.21 E-value=8.6e-10 Score=89.62 Aligned_cols=206 Identities=15% Similarity=0.193 Sum_probs=135.0
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe-----eEEEecCCCC------------CCeEEEEEec
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE-----MKWKSTGRHP------------GGLAGLAFAK 83 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~-----~~~~~~~~h~------------~~v~~v~~~~ 83 (340)
..-+.++.|...|. +||+|..+|.|.+|.-.... ....++. |. ..|+.+.|.+
T Consensus 25 adiis~vef~~~Ge---------~LatGdkgGRVv~f~r~~~~~~ey~~~t~fqs-hepEFDYLkSleieEKinkIrw~~ 94 (433)
T KOG1354|consen 25 ADIISAVEFDHYGE---------RLATGDKGGRVVLFEREKLYKGEYNFQTEFQS-HEPEFDYLKSLEIEEKINKIRWLD 94 (433)
T ss_pred hcceeeEEeecccc---------eEeecCCCCeEEEeecccccccceeeeeeeec-cCcccchhhhhhhhhhhhhceecC
Confidence 35689999999999 99999999999999754322 2222322 33 3688999998
Q ss_pred CCC--EEEEEeCCCcEEEEeCCCCeEE-----------------------------------EE-eecCCCCeeEEEEcc
Q 036605 84 KGR--SLHVVGTNGMASEMKSEMGEVI-----------------------------------RE-FKASEKPISSSAFLC 125 (340)
Q Consensus 84 ~~~--~l~s~~~dg~i~~wd~~~~~~~-----------------------------------~~-~~~~~~~i~~l~~~~ 125 (340)
+++ .++..+.|.+|++|.+...... +. -.+|..-|.+|.++.
T Consensus 95 ~~n~a~FLlstNdktiKlWKi~er~~k~~~~~~~~~~~~~~~~~lr~p~~~~~~~~vea~prRv~aNaHtyhiNSIS~Ns 174 (433)
T KOG1354|consen 95 DGNLAEFLLSTNDKTIKLWKIRERGSKKEGYNLPEEGPPGTITSLRLPVEGRHDLEVEASPRRVYANAHTYHINSISVNS 174 (433)
T ss_pred CCCccEEEEecCCcceeeeeeeccccccccccccccCCCCccceeeceeeccccceeeeeeeeeccccceeEeeeeeecC
Confidence 765 5666788999999987532110 00 124566688899998
Q ss_pred CCCEEEEecCc-EEEEECCCCcee--------------------EEe----------------------e----------
Q 036605 126 EEKIFALASSE-VRILSLENGEEV--------------------LKF----------------------S---------- 152 (340)
Q Consensus 126 ~~~~l~~~~~~-i~i~d~~~~~~~--------------------~~~----------------------~---------- 152 (340)
|+..+++++.- |.+|+++--..- ..| .
T Consensus 175 D~Et~lSADdLRINLWnlei~d~sFnIVDIKP~nmEeLteVITsaEFhp~~cn~f~YSSSKGtIrLcDmR~~aLCd~hsK 254 (433)
T KOG1354|consen 175 DKETFLSADDLRINLWNLEIIDQSFNIVDIKPANMEELTEVITSAEFHPHHCNVFVYSSSKGTIRLCDMRQSALCDAHSK 254 (433)
T ss_pred ccceEeeccceeeeeccccccCCceeEEEccccCHHHHHHHHhhhccCHhHccEEEEecCCCcEEEeechhhhhhcchhh
Confidence 88888887765 777766421000 000 0
Q ss_pred ---------------cCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCcee--------e-ecCCCeeee
Q 036605 153 ---------------DDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPAL--------S-MRHSPVAID 208 (340)
Q Consensus 153 ---------------~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~--------~-~~~~~~~~~ 208 (340)
.-...|..+.|+++|+|+++-.. -+|++||+++..+........ . .+.....-.
T Consensus 255 lfEepedp~~rsffseiIsSISDvKFs~sGryilsRDy--ltvk~wD~nme~~pv~t~~vh~~lr~kLc~lYEnD~IfdK 332 (433)
T KOG1354|consen 255 LFEEPEDPSSRSFFSEIISSISDVKFSHSGRYILSRDY--LTVKLWDLNMEAKPVETYPVHEYLRSKLCSLYENDAIFDK 332 (433)
T ss_pred hhccccCCcchhhHHHHhhhhhceEEccCCcEEEEecc--ceeEEEeccccCCcceEEeehHhHHHHHHHHhhccchhhe
Confidence 00145788999999999998433 799999996554422110000 0 011222233
Q ss_pred eecCCCCCCCCEEEEEeCCCcEEEEECCCCC
Q 036605 209 CKNSPNGEDGTVILAVAESGVAYSWDLKTVS 239 (340)
Q Consensus 209 ~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~ 239 (340)
+-|+| +.++.++++|+....+++|++..+.
T Consensus 333 Fec~~-sg~~~~v~TGsy~n~frvf~~~~gs 362 (433)
T KOG1354|consen 333 FECSW-SGNDSYVMTGSYNNVFRVFNLARGS 362 (433)
T ss_pred eEEEE-cCCcceEecccccceEEEecCCCCc
Confidence 44577 7888999999999999999976543
No 253
>KOG4497 consensus Uncharacterized conserved protein WDR8, contains WD repeats [General function prediction only]
Probab=99.19 E-value=1.7e-09 Score=87.47 Aligned_cols=214 Identities=11% Similarity=0.083 Sum_probs=128.9
Q ss_pred ccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEE
Q 036605 2 WSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAF 81 (340)
Q Consensus 2 wd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~ 81 (340)
|++...+-...+. .....+..++|||||+ .+|.+..-+-.|.+|.+.+.+... +.. .+..+..++|
T Consensus 76 wsl~Qpew~ckId----eg~agls~~~WSPdgr--------hiL~tseF~lriTVWSL~t~~~~~-~~~-pK~~~kg~~f 141 (447)
T KOG4497|consen 76 WSLVQPEWYCKID----EGQAGLSSISWSPDGR--------HILLTSEFDLRITVWSLNTQKGYL-LPH-PKTNVKGYAF 141 (447)
T ss_pred EEeecceeEEEec----cCCCcceeeeECCCcc--------eEeeeecceeEEEEEEeccceeEE-ecc-cccCceeEEE
Confidence 5554444444444 4567889999999995 177778889999999998876442 232 3345689999
Q ss_pred ecCCCEEEEEeCC------------------------------------CcEEEEeCCCCeEEEEeecCCCCeeEEEEcc
Q 036605 82 AKKGRSLHVVGTN------------------------------------GMASEMKSEMGEVIREFKASEKPISSSAFLC 125 (340)
Q Consensus 82 ~~~~~~l~s~~~d------------------------------------g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~ 125 (340)
+|||++.+.++.- ..+.+||-.-.-.+..+ .-.-.+..++|+|
T Consensus 142 ~~dg~f~ai~sRrDCkdyv~i~~c~~W~ll~~f~~dT~DltgieWsPdg~~laVwd~~Leykv~aY-e~~lG~k~v~wsP 220 (447)
T KOG4497|consen 142 HPDGQFCAILSRRDCKDYVQISSCKAWILLKEFKLDTIDLTGIEWSPDGNWLAVWDNVLEYKVYAY-ERGLGLKFVEWSP 220 (447)
T ss_pred CCCCceeeeeecccHHHHHHHHhhHHHHHHHhcCCCcccccCceECCCCcEEEEecchhhheeeee-eeccceeEEEecc
Confidence 9999987765432 11223321100001111 1124677889999
Q ss_pred CCCEEEEecCc--EEEEECCCCce--------------------------------------------------------
Q 036605 126 EEKIFALASSE--VRILSLENGEE-------------------------------------------------------- 147 (340)
Q Consensus 126 ~~~~l~~~~~~--i~i~d~~~~~~-------------------------------------------------------- 147 (340)
.++++++|+.+ +++.+--+-+.
T Consensus 221 ~~qflavGsyD~~lrvlnh~tWk~f~eflhl~s~~dp~~~~~~ke~~~~~ql~~~cLsf~p~~~~a~~~~~se~~YE~~~ 300 (447)
T KOG4497|consen 221 CNQFLAVGSYDQMLRVLNHFTWKPFGEFLHLCSYHDPTLHLLEKETFSIVQLLHHCLSFTPTDLEAHIWEESETIYEQQM 300 (447)
T ss_pred ccceEEeeccchhhhhhceeeeeehhhhccchhccCchhhhhhhhhcchhhhcccccccCCCccccCccccchhhhhhhh
Confidence 99999887766 43321100000
Q ss_pred ----eEEe------ecCCCCeEEEEECCCCCEEEEEEcC-CCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCC
Q 036605 148 ----VLKF------SDDVGPLQYVSASDGAKIIITAGYG-EKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGE 216 (340)
Q Consensus 148 ----~~~~------~~~~~~v~~~~~s~~~~~l~s~~~~-d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 216 (340)
+..+ ......+..++|++|..|+++-.+. -+.+.+||+ ...+....+. ... .+..+ .| .|
T Consensus 301 ~pv~~~~lkp~tD~pnPk~g~g~lafs~Ds~y~aTrnd~~PnalW~Wdl--q~l~l~avLi---Qk~-piraf--~W-dP 371 (447)
T KOG4497|consen 301 TPVKVHKLKPPTDFPNPKCGAGKLAFSCDSTYAATRNDKYPNALWLWDL--QNLKLHAVLI---QKH-PIRAF--EW-DP 371 (447)
T ss_pred cceeeecccCCCCCCCcccccceeeecCCceEEeeecCCCCceEEEEec--hhhhhhhhhh---hcc-ceeEE--Ee-CC
Confidence 0000 0112346778999999888884432 357899998 3433333322 221 22223 44 78
Q ss_pred CCCEEEEEeCCCcEEEEECCCCC
Q 036605 217 DGTVILAVAESGVAYSWDLKTVS 239 (340)
Q Consensus 217 ~~~~l~~~s~dg~i~vwd~~~~~ 239 (340)
....|+.+....++++|......
T Consensus 372 ~~prL~vctg~srLY~W~psg~~ 394 (447)
T KOG4497|consen 372 GRPRLVVCTGKSRLYFWAPSGPR 394 (447)
T ss_pred CCceEEEEcCCceEEEEcCCCce
Confidence 88888888888889999876543
No 254
>KOG4547 consensus WD40 repeat-containing protein [General function prediction only]
Probab=99.18 E-value=4e-09 Score=91.49 Aligned_cols=187 Identities=13% Similarity=0.097 Sum_probs=139.7
Q ss_pred eEEEEEcCCCcEEEEEccCCeeEEEecC--CCCCCeEEEEEe--------------------cCCCEEEEEeCCCcEEEE
Q 036605 43 LLLALGTSNGDILAVDVLTGEMKWKSTG--RHPGGLAGLAFA--------------------KKGRSLHVVGTNGMASEM 100 (340)
Q Consensus 43 ~~l~~g~~dg~i~i~d~~~~~~~~~~~~--~h~~~v~~v~~~--------------------~~~~~l~s~~~dg~i~~w 100 (340)
.++|....||.+++|++..++....+.. .-.+..++..|. .+...++-|...|.|.+|
T Consensus 6 ~~~A~~~~~g~l~iw~t~~~~~~~e~~p~~~~s~t~~~~~w~L~~~~s~~k~~~~~~~~~~s~~t~~lvlgt~~g~v~~y 85 (541)
T KOG4547|consen 6 DYFALSTGDGRLRIWDTAKNQLQQEFAPIASLSGTCTYTKWGLSADYSPMKWLSLEKAKKASLDTSMLVLGTPQGSVLLY 85 (541)
T ss_pred heEeecCCCCeEEEEEccCceeeeeeccchhccCcceeEEEEEEeccchHHHHhHHHHhhccCCceEEEeecCCccEEEE
Confidence 3899999999999999999987776654 123445555553 122356667788999999
Q ss_pred eCCCCeEEEEee--cCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcC
Q 036605 101 KSEMGEVIREFK--ASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYG 176 (340)
Q Consensus 101 d~~~~~~~~~~~--~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~ 176 (340)
+...|+....+. .|.+.|.++.++.+-..+.+++.+ +..|+......++.+......+.+++++||+..+++++
T Consensus 86 s~~~g~it~~~st~~h~~~v~~~~~~~~~~ciyS~~ad~~v~~~~~~~~~~~~~~~~~~~~~~sl~is~D~~~l~~as-- 163 (541)
T KOG4547|consen 86 SVAGGEITAKLSTDKHYGNVNEILDAQRLGCIYSVGADLKVVYILEKEKVIIRIWKEQKPLVSSLCISPDGKILLTAS-- 163 (541)
T ss_pred EecCCeEEEEEecCCCCCcceeeecccccCceEecCCceeEEEEecccceeeeeeccCCCccceEEEcCCCCEEEecc--
Confidence 999999888776 577889999999888888886655 88999999999999998888999999999999888843
Q ss_pred CCeEEEEEccCCCCCccCCceeeecCCCeeeeeec--CCCCCCCCEEEEEe-CCCcEEEEECCC
Q 036605 177 EKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKN--SPNGEDGTVILAVA-ESGVAYSWDLKT 237 (340)
Q Consensus 177 d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~--~~~~~~~~~l~~~s-~dg~i~vwd~~~ 237 (340)
+.|.+||+ ++++....+. +|...+..+.. .+....|.+++++. .+..+.+|-+..
T Consensus 164 -~~ik~~~~--~~kevv~~ft---gh~s~v~t~~f~~~~~g~~G~~vLssa~~~r~i~~w~v~~ 221 (541)
T KOG4547|consen 164 -RQIKVLDI--ETKEVVITFT---GHGSPVRTLSFTTLIDGIIGKYVLSSAAAERGITVWVVEK 221 (541)
T ss_pred -ceEEEEEc--cCceEEEEec---CCCcceEEEEEEEeccccccceeeeccccccceeEEEEEc
Confidence 69999999 6777766666 77766655511 11123356666543 344477776554
No 255
>COG2706 3-carboxymuconate cyclase [Carbohydrate transport and metabolism]
Probab=99.15 E-value=3.9e-08 Score=80.87 Aligned_cols=206 Identities=11% Similarity=0.101 Sum_probs=133.6
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcC---CCcEEEEEccC--CeeEE--EecCCCCCCeEEEEEecCCCEEEEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTS---NGDILAVDVLT--GEMKW--KSTGRHPGGLAGLAFAKKGRSLHVV 91 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~---dg~i~i~d~~~--~~~~~--~~~~~h~~~v~~v~~~~~~~~l~s~ 91 (340)
......+-|+|+|+++ +|.++-. .|.|..|.+.. |++.. .... ...+-+.+++++++++|+++
T Consensus 37 ~~~~nptyl~~~~~~~---------~LY~v~~~~~~ggvaay~iD~~~G~Lt~ln~~~~-~g~~p~yvsvd~~g~~vf~A 106 (346)
T COG2706 37 AELGNPTYLAVNPDQR---------HLYVVNEPGEEGGVAAYRIDPDDGRLTFLNRQTL-PGSPPCYVSVDEDGRFVFVA 106 (346)
T ss_pred cccCCCceEEECCCCC---------EEEEEEecCCcCcEEEEEEcCCCCeEEEeecccc-CCCCCeEEEECCCCCEEEEE
Confidence 4557788999999998 7777654 47787777764 54322 1111 12233889999999999998
Q ss_pred eCC-CcEEEEeCCC-CeEEEE--eecCCCC----------eeEEEEccCCCEEEEec---CcEEEEECCCCceeEEe---
Q 036605 92 GTN-GMASEMKSEM-GEVIRE--FKASEKP----------ISSSAFLCEEKIFALAS---SEVRILSLENGEEVLKF--- 151 (340)
Q Consensus 92 ~~d-g~i~~wd~~~-~~~~~~--~~~~~~~----------i~~l~~~~~~~~l~~~~---~~i~i~d~~~~~~~~~~--- 151 (340)
... |.|.++.++. |.+... ...|... +....+.|++++|++.+ ..|.+|++..|+....-
T Consensus 107 nY~~g~v~v~p~~~dG~l~~~v~~~~h~g~~p~~rQ~~~h~H~a~~tP~~~~l~v~DLG~Dri~~y~~~dg~L~~~~~~~ 186 (346)
T COG2706 107 NYHSGSVSVYPLQADGSLQPVVQVVKHTGSGPHERQESPHVHSANFTPDGRYLVVPDLGTDRIFLYDLDDGKLTPADPAE 186 (346)
T ss_pred EccCceEEEEEcccCCccccceeeeecCCCCCCccccCCccceeeeCCCCCEEEEeecCCceEEEEEcccCccccccccc
Confidence 765 8999999865 432211 1223333 78889999999998843 34999999977543111
Q ss_pred ecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccC-----CceeeecCCCeeeeeecCCCCCCCCEEEEEeC
Q 036605 152 SDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNK-----GPALSMRHSPVAIDCKNSPNGEDGTVILAVAE 226 (340)
Q Consensus 152 ~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~-----~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~ 226 (340)
.......+.|.|+|++++.+....-+++|.+|..+...++... .+.-.+....+..++ .. +++|++|.+...
T Consensus 187 v~~G~GPRHi~FHpn~k~aY~v~EL~stV~v~~y~~~~g~~~~lQ~i~tlP~dF~g~~~~aaI--hi-s~dGrFLYasNR 263 (346)
T COG2706 187 VKPGAGPRHIVFHPNGKYAYLVNELNSTVDVLEYNPAVGKFEELQTIDTLPEDFTGTNWAAAI--HI-SPDGRFLYASNR 263 (346)
T ss_pred cCCCCCcceEEEcCCCcEEEEEeccCCEEEEEEEcCCCceEEEeeeeccCccccCCCCceeEE--EE-CCCCCEEEEecC
Confidence 1223556899999999999998888999999999643232111 111111112222222 22 899999988754
Q ss_pred C-CcEEEEECCC
Q 036605 227 S-GVAYSWDLKT 237 (340)
Q Consensus 227 d-g~i~vwd~~~ 237 (340)
. ..|.+|.+..
T Consensus 264 g~dsI~~f~V~~ 275 (346)
T COG2706 264 GHDSIAVFSVDP 275 (346)
T ss_pred CCCeEEEEEEcC
Confidence 2 3577777654
No 256
>PF07433 DUF1513: Protein of unknown function (DUF1513); InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=99.12 E-value=6.1e-08 Score=79.71 Aligned_cols=178 Identities=15% Similarity=0.145 Sum_probs=126.4
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcC-----CCcEEEEEcc-CCeeEEEecCCCCC
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTS-----NGDILAVDVL-TGEMKWKSTGRHPG 74 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~-----dg~i~i~d~~-~~~~~~~~~~~h~~ 74 (340)
+||+.+|+....+..+.+.|-.. --.||+||+ +|++.-+ .|.|-|||.. +-+.+..+.. |.-
T Consensus 32 v~D~~~g~~~~~~~a~~gRHFyG--Hg~fs~dG~---------~LytTEnd~~~g~G~IgVyd~~~~~~ri~E~~s-~GI 99 (305)
T PF07433_consen 32 VFDCRTGQLLQRLWAPPGRHFYG--HGVFSPDGR---------LLYTTENDYETGRGVIGVYDAARGYRRIGEFPS-HGI 99 (305)
T ss_pred EEEcCCCceeeEEcCCCCCEEec--CEEEcCCCC---------EEEEeccccCCCcEEEEEEECcCCcEEEeEecC-CCc
Confidence 57899999887777553333222 256999999 7887544 4899999998 5556667766 655
Q ss_pred CeEEEEEecCCCEEEEEeC------------------CCcEEEEeCCCCeEEEEee----cCCCCeeEEEEccCCCEEEE
Q 036605 75 GLAGLAFAKKGRSLHVVGT------------------NGMASEMKSEMGEVIREFK----ASEKPISSSAFLCEEKIFAL 132 (340)
Q Consensus 75 ~v~~v~~~~~~~~l~s~~~------------------dg~i~~wd~~~~~~~~~~~----~~~~~i~~l~~~~~~~~l~~ 132 (340)
.-..+.+.|||+.|+.+.. +..+...|..+|+.+.+.. .|...|..+++.++|..++.
T Consensus 100 GPHel~l~pDG~tLvVANGGI~Thpd~GR~kLNl~tM~psL~~ld~~sG~ll~q~~Lp~~~~~lSiRHLa~~~~G~V~~a 179 (305)
T PF07433_consen 100 GPHELLLMPDGETLVVANGGIETHPDSGRAKLNLDTMQPSLVYLDARSGALLEQVELPPDLHQLSIRHLAVDGDGTVAFA 179 (305)
T ss_pred ChhhEEEcCCCCEEEEEcCCCccCcccCceecChhhcCCceEEEecCCCceeeeeecCccccccceeeEEecCCCcEEEE
Confidence 5678889999987776421 2356777888898887743 36778999999999988876
Q ss_pred ecCc---------EEEEECCCCceeEEe-------ecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccC
Q 036605 133 ASSE---------VRILSLENGEEVLKF-------SDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNK 194 (340)
Q Consensus 133 ~~~~---------i~i~d~~~~~~~~~~-------~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~ 194 (340)
...+ +-+++... .+..+ ..-.+.+-+|++++++..+++++-..+.+.+||. .++....
T Consensus 180 ~Q~qg~~~~~~PLva~~~~g~--~~~~~~~p~~~~~~l~~Y~gSIa~~~~g~~ia~tsPrGg~~~~~d~--~tg~~~~ 253 (305)
T PF07433_consen 180 MQYQGDPGDAPPLVALHRRGG--ALRLLPAPEEQWRRLNGYIGSIAADRDGRLIAVTSPRGGRVAVWDA--ATGRLLG 253 (305)
T ss_pred EecCCCCCccCCeEEEEcCCC--cceeccCChHHHHhhCCceEEEEEeCCCCEEEEECCCCCEEEEEEC--CCCCEee
Confidence 3222 55555433 23222 2234789999999999999888887999999998 5655543
No 257
>KOG1587 consensus Cytoplasmic dynein intermediate chain [Cytoskeleton]
Probab=99.10 E-value=2.4e-09 Score=95.97 Aligned_cols=156 Identities=12% Similarity=0.047 Sum_probs=117.5
Q ss_pred CCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCee--------EEEecCCCCCCeEEEEEecCCCEEEE
Q 036605 20 PVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGEM--------KWKSTGRHPGGLAGLAFAKKGRSLHV 90 (340)
Q Consensus 20 ~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~--------~~~~~~~h~~~v~~v~~~~~~~~l~s 90 (340)
....+++++|.|.. . .+++|+..|.|..-+....+. +..+. .|.+.|+++.++|=+..++.
T Consensus 346 ~~~~~t~~~F~~~~p~---------~FiVGTe~G~v~~~~r~g~~~~~~~~~~~~~~~~-~h~g~v~~v~~nPF~~k~fl 415 (555)
T KOG1587|consen 346 KAVGATSLKFEPTDPN---------HFIVGTEEGKVYKGCRKGYTPAPEVSYKGHSTFI-THIGPVYAVSRNPFYPKNFL 415 (555)
T ss_pred cccceeeEeeccCCCc---------eEEEEcCCcEEEEEeccCCccccccccccccccc-ccCcceEeeecCCCccceee
Confidence 34678999999877 5 799999999998844332221 11233 38899999999997665555
Q ss_pred EeCCCcEEEEeCC-CCeEEEEeecCCCCeeEEEEccCCCEE-EE--ecCcEEEEECCCC--ceeEEeecCCCCeEEEEEC
Q 036605 91 VGTNGMASEMKSE-MGEVIREFKASEKPISSSAFLCEEKIF-AL--ASSEVRILSLENG--EEVLKFSDDVGPLQYVSAS 164 (340)
Q Consensus 91 ~~~dg~i~~wd~~-~~~~~~~~~~~~~~i~~l~~~~~~~~l-~~--~~~~i~i~d~~~~--~~~~~~~~~~~~v~~~~~s 164 (340)
.+.|-.+++|.-. ...++..+..+...+++++|||...-+ ++ ++|.|.+||+... .++.+...+....+.+.|+
T Consensus 416 s~gDW~vriWs~~~~~~Pl~~~~~~~~~v~~vaWSptrpavF~~~d~~G~l~iWDLl~~~~~Pv~s~~~~~~~l~~~~~s 495 (555)
T KOG1587|consen 416 SVGDWTVRIWSEDVIASPLLSLDSSPDYVTDVAWSPTRPAVFATVDGDGNLDIWDLLQDDEEPVLSQKVCSPALTRVRWS 495 (555)
T ss_pred eeccceeEeccccCCCCcchhhhhccceeeeeEEcCcCceEEEEEcCCCceehhhhhccccCCcccccccccccceeecC
Confidence 5559999999977 666777777778889999999987655 44 4455999999643 4455555556677788889
Q ss_pred CCCCEEEEEEcCCCeEEEEEcc
Q 036605 165 DGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 165 ~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
+.|+.|+.|.. .|.+.+|++.
T Consensus 496 ~~g~~lavGd~-~G~~~~~~l~ 516 (555)
T KOG1587|consen 496 PNGKLLAVGDA-NGTTHILKLS 516 (555)
T ss_pred CCCcEEEEecC-CCcEEEEEcC
Confidence 99998888766 9999999983
No 258
>KOG1409 consensus Uncharacterized conserved protein, contains WD40 repeats and FYVE domains [Function unknown]
Probab=99.09 E-value=7.3e-09 Score=84.31 Aligned_cols=155 Identities=12% Similarity=0.179 Sum_probs=118.7
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC----CeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCc
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT----GEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGM 96 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~----~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~ 96 (340)
..+++++.+.+..+ .|++|-.+|++.-+.+.. ....+.+.. |...|..+-|+-...++++++.|..
T Consensus 68 P~~~~~~~y~~e~~---------~L~vg~~ngtvtefs~sedfnkm~~~r~~~~-h~~~v~~~if~~~~e~V~s~~~dk~ 137 (404)
T KOG1409|consen 68 PSPCSAMEYVSESR---------RLYVGQDNGTVTEFALSEDFNKMTFLKDYLA-HQARVSAIVFSLTHEWVLSTGKDKQ 137 (404)
T ss_pred CCCceEeeeeccce---------EEEEEEecceEEEEEhhhhhhhcchhhhhhh-hhcceeeEEecCCceeEEEeccccc
Confidence 46899999998888 899999999999886543 333444454 8888988888877777777776644
Q ss_pred EEEEeC-----------------------------------------CCCeEEEEeecCCCCeeEEEEccCCCEEEEecC
Q 036605 97 ASEMKS-----------------------------------------EMGEVIREFKASEKPISSSAFLCEEKIFALASS 135 (340)
Q Consensus 97 i~~wd~-----------------------------------------~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~ 135 (340)
+.---. ..-.++.++.+|..++.+++|.|....|+++..
T Consensus 138 ~~~hc~e~~~~lg~Y~~~~~~t~~~~d~~~~fvGd~~gqvt~lr~~~~~~~~i~~~~~h~~~~~~l~Wd~~~~~LfSg~~ 217 (404)
T KOG1409|consen 138 FAWHCTESGNRLGGYNFETPASALQFDALYAFVGDHSGQITMLKLEQNGCQLITTFNGHTGEVTCLKWDPGQRLLFSGAS 217 (404)
T ss_pred eEEEeeccCCcccceEeeccCCCCceeeEEEEecccccceEEEEEeecCCceEEEEcCcccceEEEEEcCCCcEEEeccc
Confidence 322111 111234557789999999999999999988655
Q ss_pred c--EEEEECCCCcee-EEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 136 E--VRILSLENGEEV-LKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 136 ~--i~i~d~~~~~~~-~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
+ +.+||+...+-+ ..+.+|...|..+...+.-+.+++++. ||.|.+|+++
T Consensus 218 d~~vi~wdigg~~g~~~el~gh~~kV~~l~~~~~t~~l~S~~e-dg~i~~w~mn 270 (404)
T KOG1409|consen 218 DHSVIMWDIGGRKGTAYELQGHNDKVQALSYAQHTRQLISCGE-DGGIVVWNMN 270 (404)
T ss_pred cCceEEEeccCCcceeeeeccchhhhhhhhhhhhheeeeeccC-CCeEEEEecc
Confidence 5 999999765544 566889999999999888889999888 9999999984
No 259
>KOG0280 consensus Uncharacterized conserved protein [Amino acid transport and metabolism]
Probab=99.08 E-value=1.4e-08 Score=80.94 Aligned_cols=150 Identities=15% Similarity=0.071 Sum_probs=108.4
Q ss_pred eEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEE--EecCCCCCCeEEEEEec-CCCEEEEEeCCCcEEEE
Q 036605 24 YSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKW--KSTGRHPGGLAGLAFAK-KGRSLHVVGTNGMASEM 100 (340)
Q Consensus 24 v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~--~~~~~h~~~v~~v~~~~-~~~~l~s~~~dg~i~~w 100 (340)
..++.|++.+. -++++..+|.+.+-+...+.+.. .++. |.-.+....|+. +.+.+++|+.|+.+..|
T Consensus 124 ~lslD~~~~~~---------~i~vs~s~G~~~~v~~t~~~le~vq~wk~-He~E~Wta~f~~~~pnlvytGgDD~~l~~~ 193 (339)
T KOG0280|consen 124 ALSLDISTSGT---------KIFVSDSRGSISGVYETEMVLEKVQTWKV-HEFEAWTAKFSDKEPNLVYTGGDDGSLSCW 193 (339)
T ss_pred eeEEEeeccCc---------eEEEEcCCCcEEEEecceeeeeecccccc-cceeeeeeecccCCCceEEecCCCceEEEE
Confidence 45788888887 69999999999976655554443 6676 999999999976 44689999999999999
Q ss_pred eCC-CCeEEEE-eecCCCCeeEEEEcc-CCCEEEEecCc--EEEEECCC-CceeEEeecCCCCeEEEEECCCCC-EEEEE
Q 036605 101 KSE-MGEVIRE-FKASEKPISSSAFLC-EEKIFALASSE--VRILSLEN-GEEVLKFSDDVGPLQYVSASDGAK-IIITA 173 (340)
Q Consensus 101 d~~-~~~~~~~-~~~~~~~i~~l~~~~-~~~~l~~~~~~--i~i~d~~~-~~~~~~~~~~~~~v~~~~~s~~~~-~l~s~ 173 (340)
|++ .++.+.. .+.|...|.+|.-+| .+.++++|+.+ |++||.++ ++++..-. -.+.|+.+..+|.-. .++.+
T Consensus 194 D~R~p~~~i~~n~kvH~~GV~SI~ss~~~~~~I~TGsYDe~i~~~DtRnm~kPl~~~~-v~GGVWRi~~~p~~~~~lL~~ 272 (339)
T KOG0280|consen 194 DIRIPKTFIWHNSKVHTSGVVSIYSSPPKPTYIATGSYDECIRVLDTRNMGKPLFKAK-VGGGVWRIKHHPEIFHRLLAA 272 (339)
T ss_pred EecCCcceeeecceeeecceEEEecCCCCCceEEEeccccceeeeehhcccCccccCc-cccceEEEEecchhhhHHHHH
Confidence 998 3443333 556788899988776 46788888777 99999984 55554332 347899999988643 22222
Q ss_pred EcCCCeEEEEEc
Q 036605 174 GYGEKHLQVWRC 185 (340)
Q Consensus 174 ~~~d~~i~iwd~ 185 (340)
+. -+-.+|-+.
T Consensus 273 CM-h~G~ki~~~ 283 (339)
T KOG0280|consen 273 CM-HNGAKILDS 283 (339)
T ss_pred HH-hcCceEEEe
Confidence 33 344556665
No 260
>KOG2315 consensus Predicted translation initiation factor related to eIF-3a [Translation, ribosomal structure and biogenesis]
Probab=99.08 E-value=1.7e-08 Score=87.23 Aligned_cols=127 Identities=16% Similarity=0.277 Sum_probs=98.4
Q ss_pred CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEe--CCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCE
Q 036605 52 GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVG--TNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKI 129 (340)
Q Consensus 52 g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~--~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~ 129 (340)
.++++++++.......+. -.++|.++.|+|+++.++++- .-..+.++|++ +.++..+ ..++-.++-|+|.|++
T Consensus 251 q~Lyll~t~g~s~~V~L~--k~GPVhdv~W~~s~~EF~VvyGfMPAkvtifnlr-~~~v~df--~egpRN~~~fnp~g~i 325 (566)
T KOG2315|consen 251 QTLYLLATQGESVSVPLL--KEGPVHDVTWSPSGREFAVVYGFMPAKVTIFNLR-GKPVFDF--PEGPRNTAFFNPHGNI 325 (566)
T ss_pred ceEEEEEecCceEEEecC--CCCCceEEEECCCCCEEEEEEecccceEEEEcCC-CCEeEeC--CCCCccceEECCCCCE
Confidence 368888877434444444 578999999999998776653 34689999986 5666555 4667788999999999
Q ss_pred EEEec-----CcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcC-----CCeEEEEEc
Q 036605 130 FALAS-----SEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYG-----EKHLQVWRC 185 (340)
Q Consensus 130 l~~~~-----~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~-----d~~i~iwd~ 185 (340)
++.++ |+|-+||..+.+.+.++.. ...+-..|+|||.+|+++... |+.++||+.
T Consensus 326 i~lAGFGNL~G~mEvwDv~n~K~i~~~~a--~~tt~~eW~PdGe~flTATTaPRlrvdNg~Kiwhy 389 (566)
T KOG2315|consen 326 ILLAGFGNLPGDMEVWDVPNRKLIAKFKA--ANTTVFEWSPDGEYFLTATTAPRLRVDNGIKIWHY 389 (566)
T ss_pred EEEeecCCCCCceEEEeccchhhcccccc--CCceEEEEcCCCcEEEEEeccccEEecCCeEEEEe
Confidence 97754 4499999999888887764 344668999999999997764 788999997
No 261
>COG4946 Uncharacterized protein related to the periplasmic component of the Tol biopolymer transport system [Function unknown]
Probab=99.01 E-value=5.9e-08 Score=82.49 Aligned_cols=145 Identities=12% Similarity=0.070 Sum_probs=114.2
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCC-cEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNG-DILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMA 97 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg-~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i 97 (340)
++...|.-..+.-+++ -++.|..|| .+-|||..+++.. ++.. .-+.|.++..+++|+.++.+.....+
T Consensus 357 ~~~~~VrY~r~~~~~e---------~~vigt~dgD~l~iyd~~~~e~k-r~e~-~lg~I~av~vs~dGK~~vvaNdr~el 425 (668)
T COG4946 357 GKKGGVRYRRIQVDPE---------GDVIGTNDGDKLGIYDKDGGEVK-RIEK-DLGNIEAVKVSPDGKKVVVANDRFEL 425 (668)
T ss_pred CCCCceEEEEEccCCc---------ceEEeccCCceEEEEecCCceEE-EeeC-CccceEEEEEcCCCcEEEEEcCceEE
Confidence 3555677667766665 689999999 8999999988644 5555 67899999999999999998888999
Q ss_pred EEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec------CcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEE
Q 036605 98 SEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALAS------SEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIII 171 (340)
Q Consensus 98 ~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~------~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~ 171 (340)
.+.|+.+|+....=+...+-|+.++|+|+++++|-+- ..|++||+.+++.. ..+...+.-.+.+|.||+++|.
T Consensus 426 ~vididngnv~~idkS~~~lItdf~~~~nsr~iAYafP~gy~tq~Iklydm~~~Kiy-~vTT~ta~DfsPaFD~d~ryLY 504 (668)
T COG4946 426 WVIDIDNGNVRLIDKSEYGLITDFDWHPNSRWIAYAFPEGYYTQSIKLYDMDGGKIY-DVTTPTAYDFSPAFDPDGRYLY 504 (668)
T ss_pred EEEEecCCCeeEecccccceeEEEEEcCCceeEEEecCcceeeeeEEEEecCCCeEE-EecCCcccccCcccCCCCcEEE
Confidence 9999999997666556667899999999999998742 23999999988654 3333344446679999999987
Q ss_pred EEEc
Q 036605 172 TAGY 175 (340)
Q Consensus 172 s~~~ 175 (340)
.-+.
T Consensus 505 fLs~ 508 (668)
T COG4946 505 FLSA 508 (668)
T ss_pred EEec
Confidence 7544
No 262
>KOG3914 consensus WD repeat protein WDR4 [Function unknown]
Probab=99.01 E-value=1.1e-08 Score=84.87 Aligned_cols=159 Identities=17% Similarity=0.180 Sum_probs=104.9
Q ss_pred CeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeE----EEEeecCCCCeeEEEEccCCCEEEE--ecCc---EEEEECCCC
Q 036605 75 GLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEV----IREFKASEKPISSSAFLCEEKIFAL--ASSE---VRILSLENG 145 (340)
Q Consensus 75 ~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~----~~~~~~~~~~i~~l~~~~~~~~l~~--~~~~---i~i~d~~~~ 145 (340)
....+..++++++|+.+..+....+++...... +.... -...-+++.+..+...... ..++ +.+|....+
T Consensus 64 a~~~~~~s~~~~llAv~~~~K~~~~f~~~~~~~~~kl~~~~~-v~~~~~ai~~~~~~~sv~v~dkagD~~~~di~s~~~~ 142 (390)
T KOG3914|consen 64 APALVLTSDSGRLVAVATSSKQRAVFDYRENPKGAKLLDVSC-VPKRPTAISFIREDTSVLVADKAGDVYSFDILSADSG 142 (390)
T ss_pred cccccccCCCceEEEEEeCCCceEEEEEecCCCcceeeeEee-cccCcceeeeeeccceEEEEeecCCceeeeeeccccc
Confidence 345556677888888888887776776654332 11221 1223345555555544443 3344 555555444
Q ss_pred ceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEe
Q 036605 146 EEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVA 225 (340)
Q Consensus 146 ~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s 225 (340)
......+|...+..++|+||+++|+++.. |..|+|-.++ .. ...-.+.++|...+-.+ +. -++..|++++
T Consensus 143 -~~~~~lGhvSml~dVavS~D~~~IitaDR-DEkIRvs~yp--a~--f~IesfclGH~eFVS~i--sl--~~~~~LlS~s 212 (390)
T KOG3914|consen 143 -RCEPILGHVSMLLDVAVSPDDQFIITADR-DEKIRVSRYP--AT--FVIESFCLGHKEFVSTI--SL--TDNYLLLSGS 212 (390)
T ss_pred -CcchhhhhhhhhheeeecCCCCEEEEecC-CceEEEEecC--cc--cchhhhccccHhheeee--ee--ccCceeeecC
Confidence 33455789999999999999999999666 9999998772 22 23334455777766655 33 3445689999
Q ss_pred CCCcEEEEECCCCCccCCC
Q 036605 226 ESGVAYSWDLKTVSQDEKT 244 (340)
Q Consensus 226 ~dg~i~vwd~~~~~~~~~~ 244 (340)
.|++|++||+.+++.+..+
T Consensus 213 GD~tlr~Wd~~sgk~L~t~ 231 (390)
T KOG3914|consen 213 GDKTLRLWDITSGKLLDTC 231 (390)
T ss_pred CCCcEEEEecccCCccccc
Confidence 9999999999998887643
No 263
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=98.99 E-value=4.1e-07 Score=74.66 Aligned_cols=211 Identities=17% Similarity=0.199 Sum_probs=126.2
Q ss_pred ccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEE
Q 036605 2 WSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAF 81 (340)
Q Consensus 2 wd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~ 81 (340)
||+.+|+.+-.+... .......+. ..+++. .+++++.++.|+.||..+|+.++++.. .+.+....
T Consensus 8 ~d~~tG~~~W~~~~~--~~~~~~~~~-~~~~~~---------~v~~~~~~~~l~~~d~~tG~~~W~~~~--~~~~~~~~- 72 (238)
T PF13360_consen 8 LDPRTGKELWSYDLG--PGIGGPVAT-AVPDGG---------RVYVASGDGNLYALDAKTGKVLWRFDL--PGPISGAP- 72 (238)
T ss_dssp EETTTTEEEEEEECS--SSCSSEEET-EEEETT---------EEEEEETTSEEEEEETTTSEEEEEEEC--SSCGGSGE-
T ss_pred EECCCCCEEEEEECC--CCCCCccce-EEEeCC---------EEEEEcCCCEEEEEECCCCCEEEEeec--ccccccee-
Confidence 688889888766521 101222222 233454 577888999999999999999988874 22221111
Q ss_pred ecCCCEEEEEeCCCcEEEEeCCCCeEEEEe-ecCCC---CeeEEEEccCCCEEEE-e-cCcEEEEECCCCceeEEeecCC
Q 036605 82 AKKGRSLHVVGTNGMASEMKSEMGEVIREF-KASEK---PISSSAFLCEEKIFAL-A-SSEVRILSLENGEEVLKFSDDV 155 (340)
Q Consensus 82 ~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~-~~~~~---~i~~l~~~~~~~~l~~-~-~~~i~i~d~~~~~~~~~~~~~~ 155 (340)
...+..++.++.++.+..+|..+|+.+... ..... ..........+..+++ . ++.|..+|+++|+.+..+....
T Consensus 73 ~~~~~~v~v~~~~~~l~~~d~~tG~~~W~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~g~l~~~d~~tG~~~w~~~~~~ 152 (238)
T PF13360_consen 73 VVDGGRVYVGTSDGSLYALDAKTGKVLWSIYLTSSPPAGVRSSSSPAVDGDRLYVGTSSGKLVALDPKTGKLLWKYPVGE 152 (238)
T ss_dssp EEETTEEEEEETTSEEEEEETTTSCEEEEEEE-SSCTCSTB--SEEEEETTEEEEEETCSEEEEEETTTTEEEEEEESST
T ss_pred eecccccccccceeeeEecccCCcceeeeeccccccccccccccCceEecCEEEEEeccCcEEEEecCCCcEEEEeecCC
Confidence 224667777788889999999999998874 32211 1112222223555544 3 5669999999999887775533
Q ss_pred CC----------eEEEEECCCCCEEEEEEcCCCe-EEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEE
Q 036605 156 GP----------LQYVSASDGAKIIITAGYGEKH-LQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAV 224 (340)
Q Consensus 156 ~~----------v~~~~~s~~~~~l~s~~~~d~~-i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~ 224 (340)
.. +..-....++ .++.+.. ++. +.+ |+ .+++.. ... . ...... .. ...+..|+.+
T Consensus 153 ~~~~~~~~~~~~~~~~~~~~~~-~v~~~~~-~g~~~~~-d~--~tg~~~--w~~--~-~~~~~~---~~-~~~~~~l~~~ 218 (238)
T PF13360_consen 153 PRGSSPISSFSDINGSPVISDG-RVYVSSG-DGRVVAV-DL--ATGEKL--WSK--P-ISGIYS---LP-SVDGGTLYVT 218 (238)
T ss_dssp T-SS--EEEETTEEEEEECCTT-EEEEECC-TSSEEEE-ET--TTTEEE--EEE--C-SS-ECE---CE-ECCCTEEEEE
T ss_pred CCCCcceeeecccccceEEECC-EEEEEcC-CCeEEEE-EC--CCCCEE--EEe--c-CCCccC---Cc-eeeCCEEEEE
Confidence 22 1222223344 5555555 664 555 87 455422 111 1 111111 11 3566778877
Q ss_pred eCCCcEEEEECCCCCcc
Q 036605 225 AESGVAYSWDLKTVSQD 241 (340)
Q Consensus 225 s~dg~i~vwd~~~~~~~ 241 (340)
+.++.|..||+.+++.+
T Consensus 219 ~~~~~l~~~d~~tG~~~ 235 (238)
T PF13360_consen 219 SSDGRLYALDLKTGKVV 235 (238)
T ss_dssp ETTTEEEEEETTTTEEE
T ss_pred eCCCEEEEEECCCCCEE
Confidence 89999999999998754
No 264
>KOG4190 consensus Uncharacterized conserved protein [Function unknown]
Probab=98.98 E-value=1.1e-09 Score=94.42 Aligned_cols=182 Identities=13% Similarity=0.154 Sum_probs=128.1
Q ss_pred EEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCC-------CeEEEEeecCCCCeeEEEEccCCCEEEEecCcE
Q 036605 65 KWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEM-------GEVIREFKASEKPISSSAFLCEEKIFALASSEV 137 (340)
Q Consensus 65 ~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~-------~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~i 137 (340)
++.+.+ |+..|..++--.+.+.+++++.|.+|++|.++. .....++..|+.+|.++.|-.+.++++++++-|
T Consensus 728 L~nf~G-H~~~iRai~AidNENSFiSASkDKTVKLWSik~EgD~~~tsaCQfTY~aHkk~i~~igfL~~lr~i~ScD~gi 806 (1034)
T KOG4190|consen 728 LCNFTG-HQEKIRAIAAIDNENSFISASKDKTVKLWSIKPEGDEIGTSACQFTYQAHKKPIHDIGFLADLRSIASCDGGI 806 (1034)
T ss_pred eecccC-cHHHhHHHHhcccccceeeccCCceEEEEEeccccCccccceeeeEhhhccCcccceeeeeccceeeeccCcc
Confidence 345566 999999888777888999999999999999863 224456778999999999999999999999999
Q ss_pred EEEECCCCceeEEe--ecCCCCeEEEEECC--CCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCC-eeeeeecC
Q 036605 138 RILSLENGEEVLKF--SDDVGPLQYVSASD--GAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSP-VAIDCKNS 212 (340)
Q Consensus 138 ~i~d~~~~~~~~~~--~~~~~~v~~~~~s~--~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~-~~~~~~~~ 212 (340)
++||.--++.+... ....+.+..+..-+ +...+++++....+|+++|.+ .++....+.......+ ....+. .
T Consensus 807 HlWDPFigr~Laq~~dapk~~a~~~ikcl~nv~~~iliAgcsaeSTVKl~DaR--sce~~~E~kVcna~~Pna~~R~i-a 883 (1034)
T KOG4190|consen 807 HLWDPFIGRLLAQMEDAPKEGAGGNIKCLENVDRHILIAGCSAESTVKLFDAR--SCEWTCELKVCNAPGPNALTRAI-A 883 (1034)
T ss_pred eeecccccchhHhhhcCcccCCCceeEecccCcchheeeeccchhhheeeecc--cccceeeEEeccCCCCchheeEE-E
Confidence 99998777666433 11223334444333 444555554558999999984 4443333222211111 111110 1
Q ss_pred CCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCCceEEE
Q 036605 213 PNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNPAKITV 251 (340)
Q Consensus 213 ~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p~~i~~ 251 (340)
. .+.|.+++++-..|+|.+.|.++++.+...+|....+
T Consensus 884 V-a~~GN~lAa~LSnGci~~LDaR~G~vINswrpmecdl 921 (1034)
T KOG4190|consen 884 V-ADKGNKLAAALSNGCIAILDARNGKVINSWRPMECDL 921 (1034)
T ss_pred e-ccCcchhhHHhcCCcEEEEecCCCceeccCCcccchh
Confidence 2 6889999999999999999999999888888844433
No 265
>KOG0280 consensus Uncharacterized conserved protein [Amino acid transport and metabolism]
Probab=98.97 E-value=1.4e-07 Score=75.47 Aligned_cols=182 Identities=12% Similarity=0.041 Sum_probs=117.5
Q ss_pred CCcEEEEEccCCeeEE--EecCCCCCCeEEEEEec---CCC-EEEEEeCCCcEEEEeCCCCeEEEEeecCC---C---Ce
Q 036605 51 NGDILAVDVLTGEMKW--KSTGRHPGGLAGLAFAK---KGR-SLHVVGTNGMASEMKSEMGEVIREFKASE---K---PI 118 (340)
Q Consensus 51 dg~i~i~d~~~~~~~~--~~~~~h~~~v~~v~~~~---~~~-~l~s~~~dg~i~~wd~~~~~~~~~~~~~~---~---~i 118 (340)
.|.+.+|++...+... .++..-...+..+.|.. +|. .|+-+..+|.|.++..........+.+-. . ..
T Consensus 45 ~Gkl~Lys~~d~~~~~l~~~q~~dts~~~dm~w~~~~~~g~~~l~~a~a~G~i~~~r~~~~~ss~~L~~ls~~ki~~~~~ 124 (339)
T KOG0280|consen 45 SGKLHLYSLEDMKLSPLDTLQCTDTSTEFDMLWRIRETDGDFNLLDAHARGQIQLYRNDEDESSVHLRGLSSKKISVVEA 124 (339)
T ss_pred ccceEEEeecccccCccceeeeecccccceeeeeeccCCccceeeeccccceEEEEeeccceeeeeecccchhhhhheee
Confidence 4788999988766433 22222345677888864 344 45666778999998766544444443221 1 13
Q ss_pred eEEEEccCCCEEEEecCc--EEEEECCCCc--eeEEeecCCCCeEEEEECCCCC-EEEEEEcCCCeEEEEEccCCCCCcc
Q 036605 119 SSSAFLCEEKIFALASSE--VRILSLENGE--EVLKFSDDVGPLQYVSASDGAK-IIITAGYGEKHLQVWRCDISSKTVN 193 (340)
Q Consensus 119 ~~l~~~~~~~~l~~~~~~--i~i~d~~~~~--~~~~~~~~~~~v~~~~~s~~~~-~l~s~~~~d~~i~iwd~~~~~~~~~ 193 (340)
-++.|++.+..+++.+.+ +.+-+..... .++.++.|....+...|+.... .+++|+. |+.+..||+|.+. +.
T Consensus 125 lslD~~~~~~~i~vs~s~G~~~~v~~t~~~le~vq~wk~He~E~Wta~f~~~~pnlvytGgD-D~~l~~~D~R~p~-~~- 201 (339)
T KOG0280|consen 125 LSLDISTSGTKIFVSDSRGSISGVYETEMVLEKVQTWKVHEFEAWTAKFSDKEPNLVYTGGD-DGSLSCWDIRIPK-TF- 201 (339)
T ss_pred eEEEeeccCceEEEEcCCCcEEEEecceeeeeecccccccceeeeeeecccCCCceEEecCC-CceEEEEEecCCc-ce-
Confidence 467788888888775544 5544433332 3357889999999999976655 4555555 9999999997332 11
Q ss_pred CCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 194 KGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 194 ~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
...-...|...+..+.+. .|.+.++++|+.|-.|++||.++.
T Consensus 202 -i~~n~kvH~~GV~SI~ss--~~~~~~I~TGsYDe~i~~~DtRnm 243 (339)
T KOG0280|consen 202 -IWHNSKVHTSGVVSIYSS--PPKPTYIATGSYDECIRVLDTRNM 243 (339)
T ss_pred -eeecceeeecceEEEecC--CCCCceEEEeccccceeeeehhcc
Confidence 111122455555555333 478899999999999999999864
No 266
>PRK04043 tolB translocation protein TolB; Provisional
Probab=98.97 E-value=6.1e-07 Score=79.47 Aligned_cols=174 Identities=10% Similarity=-0.009 Sum_probs=109.9
Q ss_pred CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCE-EEEEeC---CCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCC
Q 036605 52 GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRS-LHVVGT---NGMASEMKSEMGEVIREFKASEKPISSSAFLCEE 127 (340)
Q Consensus 52 g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~-l~s~~~---dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~ 127 (340)
..|.+-|..... ...+.. . +.+....|+|||+. ++..+. +..|.++|+.+++..... ..........|+|||
T Consensus 169 ~~l~~~d~dg~~-~~~~~~-~-~~~~~p~wSpDG~~~i~y~s~~~~~~~Iyv~dl~tg~~~~lt-~~~g~~~~~~~SPDG 244 (419)
T PRK04043 169 SNIVLADYTLTY-QKVIVK-G-GLNIFPKWANKEQTAFYYTSYGERKPTLYKYNLYTGKKEKIA-SSQGMLVVSDVSKDG 244 (419)
T ss_pred ceEEEECCCCCc-eeEEcc-C-CCeEeEEECCCCCcEEEEEEccCCCCEEEEEECCCCcEEEEe-cCCCcEEeeEECCCC
Confidence 466666655443 444443 3 37789999999984 554443 357999999988765443 344556678899999
Q ss_pred CEEEE-e----cCcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecC
Q 036605 128 KIFAL-A----SSEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRH 202 (340)
Q Consensus 128 ~~l~~-~----~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~ 202 (340)
+.++. . ..+|+++|+.+++ ...+..+........|+|||+.|+..+...+.-.||-++..+++... +.. .
T Consensus 245 ~~la~~~~~~g~~~Iy~~dl~~g~-~~~LT~~~~~d~~p~~SPDG~~I~F~Sdr~g~~~Iy~~dl~~g~~~r-lt~--~- 319 (419)
T PRK04043 245 SKLLLTMAPKGQPDIYLYDTNTKT-LTQITNYPGIDVNGNFVEDDKRIVFVSDRLGYPNIFMKKLNSGSVEQ-VVF--H- 319 (419)
T ss_pred CEEEEEEccCCCcEEEEEECCCCc-EEEcccCCCccCccEECCCCCEEEEEECCCCCceEEEEECCCCCeEe-Ccc--C-
Confidence 87754 2 2349999998875 44555444434567899999988887765555445544334443322 211 1
Q ss_pred CCeeeeeecCCCCCCCCEEEEEeCC---------CcEEEEECCCCC
Q 036605 203 SPVAIDCKNSPNGEDGTVILAVAES---------GVAYSWDLKTVS 239 (340)
Q Consensus 203 ~~~~~~~~~~~~~~~~~~l~~~s~d---------g~i~vwd~~~~~ 239 (340)
..... .| +|+|.+++..+.. ..|++.|+.++.
T Consensus 320 g~~~~----~~-SPDG~~Ia~~~~~~~~~~~~~~~~I~v~d~~~g~ 360 (419)
T PRK04043 320 GKNNS----SV-STYKNYIVYSSRETNNEFGKNTFNLYLISTNSDY 360 (419)
T ss_pred CCcCc----eE-CCCCCEEEEEEcCCCcccCCCCcEEEEEECCCCC
Confidence 11111 34 8999988877654 267888877654
No 267
>KOG3914 consensus WD repeat protein WDR4 [Function unknown]
Probab=98.96 E-value=1.2e-08 Score=84.68 Aligned_cols=156 Identities=14% Similarity=0.165 Sum_probs=103.9
Q ss_pred EEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecC--CCCCCeEEEEEecCCCEEEEEe---CCCcEEE
Q 036605 25 SCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTG--RHPGGLAGLAFAKKGRSLHVVG---TNGMASE 99 (340)
Q Consensus 25 ~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~--~h~~~v~~v~~~~~~~~l~s~~---~dg~i~~ 99 (340)
.....+|.++ +||++..+....+++........++-. .-...-+++.|..+......+. +...+.+
T Consensus 66 ~~~~~s~~~~---------llAv~~~~K~~~~f~~~~~~~~~kl~~~~~v~~~~~ai~~~~~~~sv~v~dkagD~~~~di 136 (390)
T KOG3914|consen 66 ALVLTSDSGR---------LVAVATSSKQRAVFDYRENPKGAKLLDVSCVPKRPTAISFIREDTSVLVADKAGDVYSFDI 136 (390)
T ss_pred cccccCCCce---------EEEEEeCCCceEEEEEecCCCcceeeeEeecccCcceeeeeeccceEEEEeecCCceeeee
Confidence 3445567778 999999888877777655432111110 0222334555555555444443 4455566
Q ss_pred EeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEe-ecCCCCeEEEEECCCCCEEEEEEcC
Q 036605 100 MKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKF-SDDVGPLQYVSASDGAKIIITAGYG 176 (340)
Q Consensus 100 wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~-~~~~~~v~~~~~s~~~~~l~s~~~~ 176 (340)
|....+... .+-+|-+-++.++++||+++++++|++ |++-.+..--.+..| .+|..-|..++.-++. .|++++.
T Consensus 137 ~s~~~~~~~-~~lGhvSml~dVavS~D~~~IitaDRDEkIRvs~ypa~f~IesfclGH~eFVS~isl~~~~-~LlS~sG- 213 (390)
T KOG3914|consen 137 LSADSGRCE-PILGHVSMLLDVAVSPDDQFIITADRDEKIRVSRYPATFVIESFCLGHKEFVSTISLTDNY-LLLSGSG- 213 (390)
T ss_pred ecccccCcc-hhhhhhhhhheeeecCCCCEEEEecCCceEEEEecCcccchhhhccccHhheeeeeeccCc-eeeecCC-
Confidence 665554433 345788899999999999999999998 777666555455555 5799999999998764 4777665
Q ss_pred CCeEEEEEccCCCCCccC
Q 036605 177 EKHLQVWRCDISSKTVNK 194 (340)
Q Consensus 177 d~~i~iwd~~~~~~~~~~ 194 (340)
|++|++||+ .++..+.
T Consensus 214 D~tlr~Wd~--~sgk~L~ 229 (390)
T KOG3914|consen 214 DKTLRLWDI--TSGKLLD 229 (390)
T ss_pred CCcEEEEec--ccCCccc
Confidence 999999999 4555444
No 268
>PLN02919 haloacid dehalogenase-like hydrolase family protein
Probab=98.95 E-value=6.7e-07 Score=87.82 Aligned_cols=198 Identities=17% Similarity=0.149 Sum_probs=122.3
Q ss_pred eEEEEeeccccccccccCceEEEE-EcCCCcEEEEEccCCeeEEEecCC-C---------------CCCeEEEEEecC-C
Q 036605 24 YSCLACGFVGKKRRKERGTLLLAL-GTSNGDILAVDVLTGEMKWKSTGR-H---------------PGGLAGLAFAKK-G 85 (340)
Q Consensus 24 v~~l~~sp~~~~~~~~~~~~~l~~-g~~dg~i~i~d~~~~~~~~~~~~~-h---------------~~~v~~v~~~~~-~ 85 (340)
...+++.+++. .|++ -..++.|+++|..++. +.++.+. . -..-.+++|+|+ +
T Consensus 626 P~GIavd~~gn---------~LYVaDt~n~~Ir~id~~~~~-V~tlag~G~~g~~~~gg~~~~~~~ln~P~gVa~dp~~g 695 (1057)
T PLN02919 626 PQGLAYNAKKN---------LLYVADTENHALREIDFVNET-VRTLAGNGTKGSDYQGGKKGTSQVLNSPWDVCFEPVNE 695 (1057)
T ss_pred CcEEEEeCCCC---------EEEEEeCCCceEEEEecCCCE-EEEEeccCcccCCCCCChhhhHhhcCCCeEEEEecCCC
Confidence 46788888765 4444 4556789999988765 3333210 0 012368999995 4
Q ss_pred CEEEEEeCCCcEEEEeCCCCeEEEEeecC---------------CCCeeEEEEccCCCEEEEec---CcEEEEECCCCce
Q 036605 86 RSLHVVGTNGMASEMKSEMGEVIREFKAS---------------EKPISSSAFLCEEKIFALAS---SEVRILSLENGEE 147 (340)
Q Consensus 86 ~~l~s~~~dg~i~~wd~~~~~~~~~~~~~---------------~~~i~~l~~~~~~~~l~~~~---~~i~i~d~~~~~~ 147 (340)
..+++.+.++.|++||..++... .+.+. -.....|+++|++..|++++ +.|++||+.++..
T Consensus 696 ~LyVad~~~~~I~v~d~~~g~v~-~~~G~G~~~~~~g~~~~~~~~~~P~GIavspdG~~LYVADs~n~~Irv~D~~tg~~ 774 (1057)
T PLN02919 696 KVYIAMAGQHQIWEYNISDGVTR-VFSGDGYERNLNGSSGTSTSFAQPSGISLSPDLKELYIADSESSSIRALDLKTGGS 774 (1057)
T ss_pred eEEEEECCCCeEEEEECCCCeEE-EEecCCccccCCCCccccccccCccEEEEeCCCCEEEEEECCCCeEEEEECCCCcE
Confidence 45555567789999999877543 22111 12346799999998665543 3499999987643
Q ss_pred eEEe-------------ecC--------CCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCcee--------
Q 036605 148 VLKF-------------SDD--------VGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPAL-------- 198 (340)
Q Consensus 148 ~~~~-------------~~~--------~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~-------- 198 (340)
.... ... -.....++++++|..+++ ...++.|++||.. ++........
T Consensus 775 ~~~~gg~~~~~~~l~~fG~~dG~g~~~~l~~P~Gvavd~dG~LYVA-Ds~N~rIrviD~~--tg~v~tiaG~G~~G~~dG 851 (1057)
T PLN02919 775 RLLAGGDPTFSDNLFKFGDHDGVGSEVLLQHPLGVLCAKDGQIYVA-DSYNHKIKKLDPA--TKRVTTLAGTGKAGFKDG 851 (1057)
T ss_pred EEEEecccccCcccccccCCCCchhhhhccCCceeeEeCCCcEEEE-ECCCCEEEEEECC--CCeEEEEeccCCcCCCCC
Confidence 2111 000 112468899999986666 4448999999983 3321110000
Q ss_pred ----eecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCc
Q 036605 199 ----SMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQ 240 (340)
Q Consensus 199 ----~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~ 240 (340)
..-..+.-+.+ +++|..+++-+.++.|++||+.++..
T Consensus 852 ~~~~a~l~~P~GIav-----d~dG~lyVaDt~Nn~Irvid~~~~~~ 892 (1057)
T PLN02919 852 KALKAQLSEPAGLAL-----GENGRLFVADTNNSLIRYLDLNKGEA 892 (1057)
T ss_pred cccccccCCceEEEE-----eCCCCEEEEECCCCEEEEEECCCCcc
Confidence 00012223333 67888888888999999999988654
No 269
>KOG1334 consensus WD40 repeat protein [General function prediction only]
Probab=98.93 E-value=1.3e-08 Score=86.56 Aligned_cols=202 Identities=11% Similarity=0.117 Sum_probs=138.8
Q ss_pred CCCCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCeeEEEe--cCCCCC---CeEEEEEecCCC-EEEE
Q 036605 18 GEPVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKS--TGRHPG---GLAGLAFAKKGR-SLHV 90 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~--~~~h~~---~v~~v~~~~~~~-~l~s 90 (340)
..|.++|.-++.-|+. . -|.+++.|+.+.-+|+..+.....+ ...+.. ..+.++.+|... .+++
T Consensus 229 ~~h~g~vhklav~p~sp~---------~f~S~geD~~v~~~Dlr~~~pa~~~~cr~~~~~~~v~L~~Ia~~P~nt~~faV 299 (559)
T KOG1334|consen 229 APHEGPVHKLAVEPDSPK---------PFLSCGEDAVVFHIDLRQDVPAEKFVCREADEKERVGLYTIAVDPRNTNEFAV 299 (559)
T ss_pred ccccCccceeeecCCCCC---------cccccccccceeeeeeccCCccceeeeeccCCccceeeeeEecCCCCcccccc
Confidence 3688899999999887 4 6889999999999998876533222 221333 468889998655 7899
Q ss_pred EeCCCcEEEEeCCCCeE------EEEee------cCCCCeeEEEEccCCCE-EEE-ecCcEEEEECCC--C---------
Q 036605 91 VGTNGMASEMKSEMGEV------IREFK------ASEKPISSSAFLCEEKI-FAL-ASSEVRILSLEN--G--------- 145 (340)
Q Consensus 91 ~~~dg~i~~wd~~~~~~------~~~~~------~~~~~i~~l~~~~~~~~-l~~-~~~~i~i~d~~~--~--------- 145 (340)
++.|-.+++||.+.-.. +..|- .....|++++++.++.- |++ .+..|+++.-.. |
T Consensus 300 gG~dqf~RvYD~R~~~~e~~n~~~~~f~p~hl~~d~~v~ITgl~Ysh~~sElLaSYnDe~IYLF~~~~~~G~~p~~~s~~ 379 (559)
T KOG1334|consen 300 GGSDQFARVYDQRRIDKEENNGVLDKFCPHHLVEDDPVNITGLVYSHDGSELLASYNDEDIYLFNKSMGDGSEPDPSSPR 379 (559)
T ss_pred CChhhhhhhhcccchhhccccchhhhcCCccccccCcccceeEEecCCccceeeeecccceEEeccccccCCCCCCCcch
Confidence 99999999999764321 12221 23446899999966544 444 555588885332 2
Q ss_pred -ceeE-EeecCCC--CeEEEEE-CCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCE
Q 036605 146 -EEVL-KFSDDVG--PLQYVSA-SDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTV 220 (340)
Q Consensus 146 -~~~~-~~~~~~~--~v~~~~~-s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 220 (340)
..+. .+++|.. .|..+-| -|...|+++|+. -|.|.||+- .+++.+..+. +... ++.| ...+|--..
T Consensus 380 ~~~~k~vYKGHrN~~TVKgVNFfGPrsEyVvSGSD-CGhIFiW~K--~t~eii~~Me---gDr~-VVNC--LEpHP~~Pv 450 (559)
T KOG1334|consen 380 EQYVKRVYKGHRNSRTVKGVNFFGPRSEYVVSGSD-CGHIFIWDK--KTGEIIRFME---GDRH-VVNC--LEPHPHLPV 450 (559)
T ss_pred hhccchhhcccccccccceeeeccCccceEEecCc-cceEEEEec--chhHHHHHhh---cccc-eEec--cCCCCCCch
Confidence 1122 3677863 4667765 677889999777 899999996 4555544443 3333 4333 455777788
Q ss_pred EEEEeCCCcEEEEECCC
Q 036605 221 ILAVAESGVAYSWDLKT 237 (340)
Q Consensus 221 l~~~s~dg~i~vwd~~~ 237 (340)
|++.+-|..|+||--.+
T Consensus 451 LAsSGid~DVKIWTP~~ 467 (559)
T KOG1334|consen 451 LASSGIDHDVKIWTPLT 467 (559)
T ss_pred hhccCCccceeeecCCc
Confidence 99999999999998644
No 270
>PF08450 SGL: SMP-30/Gluconolaconase/LRE-like region; InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=98.92 E-value=3.5e-06 Score=69.56 Aligned_cols=195 Identities=17% Similarity=0.177 Sum_probs=123.7
Q ss_pred EEEeec-cccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCC
Q 036605 26 CLACGF-VGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEM 104 (340)
Q Consensus 26 ~l~~sp-~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~ 104 (340)
+.+|.+ ++. ++++-...+.|+.|+..++.... +.. . ....+++...+..|+.+..+ .+.++|+.+
T Consensus 4 gp~~d~~~g~---------l~~~D~~~~~i~~~~~~~~~~~~-~~~--~-~~~G~~~~~~~g~l~v~~~~-~~~~~d~~~ 69 (246)
T PF08450_consen 4 GPVWDPRDGR---------LYWVDIPGGRIYRVDPDTGEVEV-IDL--P-GPNGMAFDRPDGRLYVADSG-GIAVVDPDT 69 (246)
T ss_dssp EEEEETTTTE---------EEEEETTTTEEEEEETTTTEEEE-EES--S-SEEEEEEECTTSEEEEEETT-CEEEEETTT
T ss_pred ceEEECCCCE---------EEEEEcCCCEEEEEECCCCeEEE-Eec--C-CCceEEEEccCCEEEEEEcC-ceEEEecCC
Confidence 578887 567 88888889999999998886443 332 2 27788888334566666665 455559999
Q ss_pred CeEEEEeec-----CCCCeeEEEEccCCCEEEEec----------CcEEEEECCCCceeEEeecCCCCeEEEEECCCCCE
Q 036605 105 GEVIREFKA-----SEKPISSSAFLCEEKIFALAS----------SEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKI 169 (340)
Q Consensus 105 ~~~~~~~~~-----~~~~i~~l~~~~~~~~l~~~~----------~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~ 169 (340)
++....... .....+.+++.|+|++.++.. +.|+.++.. ++.. .+...-...+.++|+|+++.
T Consensus 70 g~~~~~~~~~~~~~~~~~~ND~~vd~~G~ly~t~~~~~~~~~~~~g~v~~~~~~-~~~~-~~~~~~~~pNGi~~s~dg~~ 147 (246)
T PF08450_consen 70 GKVTVLADLPDGGVPFNRPNDVAVDPDGNLYVTDSGGGGASGIDPGSVYRIDPD-GKVT-VVADGLGFPNGIAFSPDGKT 147 (246)
T ss_dssp TEEEEEEEEETTCSCTEEEEEEEE-TTS-EEEEEECCBCTTCGGSEEEEEEETT-SEEE-EEEEEESSEEEEEEETTSSE
T ss_pred CcEEEEeeccCCCcccCCCceEEEcCCCCEEEEecCCCccccccccceEEECCC-CeEE-EEecCcccccceEECCcchh
Confidence 876544433 234578999999999877732 236667766 4433 33223456789999999998
Q ss_pred EEEEEcCCCeEEEEEccCCCCCccCCce-eeecCCC---eeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 170 IITAGYGEKHLQVWRCDISSKTVNKGPA-LSMRHSP---VAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 170 l~s~~~~d~~i~iwd~~~~~~~~~~~~~-~~~~~~~---~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
|+.+....+.|..|+++........... ..+.... --+.+ ..+|...++....+.|.+++.. ++.+.
T Consensus 148 lyv~ds~~~~i~~~~~~~~~~~~~~~~~~~~~~~~~g~pDG~~v-----D~~G~l~va~~~~~~I~~~~p~-G~~~~ 218 (246)
T PF08450_consen 148 LYVADSFNGRIWRFDLDADGGELSNRRVFIDFPGGPGYPDGLAV-----DSDGNLWVADWGGGRIVVFDPD-GKLLR 218 (246)
T ss_dssp EEEEETTTTEEEEEEEETTTCCEEEEEEEEE-SSSSCEEEEEEE-----BTTS-EEEEEETTTEEEEEETT-SCEEE
T ss_pred eeecccccceeEEEeccccccceeeeeeEEEcCCCCcCCCcceE-----cCCCCEEEEEcCCCEEEEECCC-ccEEE
Confidence 8877776888888888533321111111 1122221 12223 5678877777788899999976 54433
No 271
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=98.91 E-value=1.1e-06 Score=74.87 Aligned_cols=181 Identities=14% Similarity=0.114 Sum_probs=119.0
Q ss_pred CccCCCCceeeeeeCCCC---CCCCCeEEEEeeccccccccccCceEEEEEc-C-CCcEEEEEccCCeeEEEecCC----
Q 036605 1 IWSTNDGSLLAEWKQPDG---EPVVSYSCLACGFVGKKRRKERGTLLLALGT-S-NGDILAVDVLTGEMKWKSTGR---- 71 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~---~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~-~-dg~i~i~d~~~~~~~~~~~~~---- 71 (340)
|||+.+++...++.-+.. .....-..++++|||+ +|++.. . +..|.++|+.+++.+..+.-.
T Consensus 81 v~D~~t~~~~~~i~~p~~p~~~~~~~~~~~~ls~dgk---------~l~V~n~~p~~~V~VvD~~~~kvv~ei~vp~~~~ 151 (352)
T TIGR02658 81 VIDPQTHLPIADIELPEGPRFLVGTYPWMTSLTPDNK---------TLLFYQFSPSPAVGVVDLEGKAFVRMMDVPDCYH 151 (352)
T ss_pred EEECccCcEEeEEccCCCchhhccCccceEEECCCCC---------EEEEecCCCCCEEEEEECCCCcEEEEEeCCCCcE
Confidence 588999998877763200 0122334788999998 777665 3 689999999888765544110
Q ss_pred --------------------------CCCCeEEE--------------EEec-CCCEEEEEeCCCcEEEEeCCCC-----
Q 036605 72 --------------------------HPGGLAGL--------------AFAK-KGRSLHVVGTNGMASEMKSEMG----- 105 (340)
Q Consensus 72 --------------------------h~~~v~~v--------------~~~~-~~~~l~s~~~dg~i~~wd~~~~----- 105 (340)
....+... .|.+ +|++++.... |.|.+.|+...
T Consensus 152 vy~t~e~~~~~~~~Dg~~~~v~~d~~g~~~~~~~~vf~~~~~~v~~rP~~~~~dg~~~~vs~e-G~V~~id~~~~~~~~~ 230 (352)
T TIGR02658 152 IFPTANDTFFMHCRDGSLAKVGYGTKGNPKIKPTEVFHPEDEYLINHPAYSNKSGRLVWPTYT-GKIFQIDLSSGDAKFL 230 (352)
T ss_pred EEEecCCccEEEeecCceEEEEecCCCceEEeeeeeecCCccccccCCceEcCCCcEEEEecC-CeEEEEecCCCcceec
Confidence 00001111 1233 6777766554 99999995433
Q ss_pred eEEEEeec-------CCCCeeEEEEccCCCEEEEec------------CcEEEEECCCCceeEEeecCCCCeEEEEECCC
Q 036605 106 EVIREFKA-------SEKPISSSAFLCEEKIFALAS------------SEVRILSLENGEEVLKFSDDVGPLQYVSASDG 166 (340)
Q Consensus 106 ~~~~~~~~-------~~~~i~~l~~~~~~~~l~~~~------------~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~ 166 (340)
.....+.. ......-++++|+++.+++.. +.|.++|..+++.+..+.. ...+..++++||
T Consensus 231 ~~~~~~~~~~~~~~wrP~g~q~ia~~~dg~~lyV~~~~~~~~thk~~~~~V~ViD~~t~kvi~~i~v-G~~~~~iavS~D 309 (352)
T TIGR02658 231 PAIEAFTEAEKADGWRPGGWQQVAYHRARDRIYLLADQRAKWTHKTASRFLFVVDAKTGKRLRKIEL-GHEIDSINVSQD 309 (352)
T ss_pred ceeeeccccccccccCCCcceeEEEcCCCCEEEEEecCCccccccCCCCEEEEEECCCCeEEEEEeC-CCceeeEEECCC
Confidence 22222211 123344599999999887732 3499999999999888763 347889999999
Q ss_pred CC-EEEEEEcCCCeEEEEEccCCCCCccC
Q 036605 167 AK-IIITAGYGEKHLQVWRCDISSKTVNK 194 (340)
Q Consensus 167 ~~-~l~s~~~~d~~i~iwd~~~~~~~~~~ 194 (340)
++ +|++....++.|.++|. .+++...
T Consensus 310 gkp~lyvtn~~s~~VsViD~--~t~k~i~ 336 (352)
T TIGR02658 310 AKPLLYALSTGDKTLYIFDA--ETGKELS 336 (352)
T ss_pred CCeEEEEeCCCCCcEEEEEC--cCCeEEe
Confidence 99 88876755899999998 4554443
No 272
>KOG1064 consensus RAVE (regulator of V-ATPase assembly) complex subunit RAV1/DMX protein, WD repeat superfamily [General function prediction only]
Probab=98.91 E-value=5.6e-09 Score=101.24 Aligned_cols=157 Identities=11% Similarity=0.157 Sum_probs=118.4
Q ss_pred ccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEE
Q 036605 2 WSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAF 81 (340)
Q Consensus 2 wd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~ 81 (340)
|....++.+..+... +. ..|+.+.|+..|. -+..+..||.+.+|... .+.....+. |.....++.|
T Consensus 2235 ~~w~~~~~v~~~rt~--g~-s~vtr~~f~~qGn---------k~~i~d~dg~l~l~q~~-pk~~~s~qc-hnk~~~Df~F 2300 (2439)
T KOG1064|consen 2235 FEWGHGQQVVCFRTA--GN-SRVTRSRFNHQGN---------KFGIVDGDGDLSLWQAS-PKPYTSWQC-HNKALSDFRF 2300 (2439)
T ss_pred EeccCCCeEEEeecc--Cc-chhhhhhhcccCC---------ceeeeccCCceeecccC-Ccceecccc-CCccccceee
Confidence 444455555555533 33 7888889988886 58888899999999977 445556666 9889999999
Q ss_pred ecCCCEEEEEe---CCCcEEEEeCC--CCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecC
Q 036605 82 AKKGRSLHVVG---TNGMASEMKSE--MGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDD 154 (340)
Q Consensus 82 ~~~~~~l~s~~---~dg~i~~wd~~--~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~ 154 (340)
-. ..+++++ .++.+.+||.- ....... ++|...++++++-|..+.+++|+++ |++||++..+....|+.
T Consensus 2301 i~--s~~~tag~s~d~~n~~lwDtl~~~~~s~v~-~~H~~gaT~l~~~P~~qllisggr~G~v~l~D~rqrql~h~~~~- 2376 (2439)
T KOG1064|consen 2301 IG--SLLATAGRSSDNRNVCLWDTLLPPMNSLVH-TCHDGGATVLAYAPKHQLLISGGRKGEVCLFDIRQRQLRHTFQA- 2376 (2439)
T ss_pred ee--hhhhccccCCCCCcccchhcccCcccceee-eecCCCceEEEEcCcceEEEecCCcCcEEEeehHHHHHHHHhhh-
Confidence 74 6677765 45899999943 2222222 7899999999999999999998877 99999998877666653
Q ss_pred CCCeEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 155 VGPLQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 155 ~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
+. ...++++++. .|.++||++.
T Consensus 2377 --------~~-~~~~f~~~ss-~g~ikIw~~s 2398 (2439)
T KOG1064|consen 2377 --------LD-TREYFVTGSS-EGNIKIWRLS 2398 (2439)
T ss_pred --------hh-hhheeeccCc-ccceEEEEcc
Confidence 33 4568888777 9999999983
No 273
>PF15492 Nbas_N: Neuroblastoma-amplified sequence, N terminal
Probab=98.87 E-value=1.2e-06 Score=70.23 Aligned_cols=194 Identities=16% Similarity=0.173 Sum_probs=110.0
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCC------CCCCeEEEEEecCC------CEEEE
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGR------HPGGLAGLAFAKKG------RSLHV 90 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~------h~~~v~~v~~~~~~------~~l~s 90 (340)
.-.-++||||+. +||.+...|+|++||+.... +..+... -...|.++.|.+-. ..|+.
T Consensus 45 QWRkl~WSpD~t---------lLa~a~S~G~i~vfdl~g~~-lf~I~p~~~~~~d~~~Aiagl~Fl~~~~s~~ws~ELlv 114 (282)
T PF15492_consen 45 QWRKLAWSPDCT---------LLAYAESTGTIRVFDLMGSE-LFVIPPAMSFPGDLSDAIAGLIFLEYKKSAQWSYELLV 114 (282)
T ss_pred hheEEEECCCCc---------EEEEEcCCCeEEEEecccce-eEEcCcccccCCccccceeeeEeeccccccccceeEEE
Confidence 346699999999 99999999999999987543 4344332 23467777775421 25677
Q ss_pred EeCCCcEEEEeCCC-----CeEEEEeec---CCCCeeEEEEccCCCEEEEecCcEEEEECCCCceeEEeecCCCCeEEEE
Q 036605 91 VGTNGMASEMKSEM-----GEVIREFKA---SEKPISSSAFLCEEKIFALASSEVRILSLENGEEVLKFSDDVGPLQYVS 162 (340)
Q Consensus 91 ~~~dg~i~~wd~~~-----~~~~~~~~~---~~~~i~~l~~~~~~~~l~~~~~~i~i~d~~~~~~~~~~~~~~~~v~~~~ 162 (340)
-..+|.++-|-+.. .+..+.|.. ....|.++.++|..++|++++.... +.+. -.+....+++-.
T Consensus 115 i~Y~G~L~Sy~vs~gt~q~y~e~hsfsf~~~yp~Gi~~~vy~p~h~LLlVgG~~~~----~~~~----s~a~~~GLtaWR 186 (282)
T PF15492_consen 115 INYRGQLRSYLVSVGTNQGYQENHSFSFSSHYPHGINSAVYHPKHRLLLVGGCEQN----QDGM----SKASSCGLTAWR 186 (282)
T ss_pred EeccceeeeEEEEcccCCcceeeEEEEecccCCCceeEEEEcCCCCEEEEeccCCC----CCcc----ccccccCceEEE
Confidence 78888887776532 223333332 3568999999999999888665421 0000 001111222222
Q ss_pred ECCCCCEEE-EEEcCCC------eEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEEC
Q 036605 163 ASDGAKIII-TAGYGEK------HLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDL 235 (340)
Q Consensus 163 ~s~~~~~l~-s~~~~d~------~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~ 235 (340)
.-.+..|.. +....|+ +..+|.+ ..... +.......+.+..+ +. +|||..|++...+|.|.+|++
T Consensus 187 iL~~~Pyyk~v~~~~~~~~~~~~~~~~~~~--~~~~~---fs~~~~~~d~i~km--Sl-SPdg~~La~ih~sG~lsLW~i 258 (282)
T PF15492_consen 187 ILSDSPYYKQVTSSEDDITASSKRRGLLRI--PSFKF---FSRQGQEQDGIFKM--SL-SPDGSLLACIHFSGSLSLWEI 258 (282)
T ss_pred EcCCCCcEEEccccCccccccccccceeec--cceee---eeccccCCCceEEE--EE-CCCCCEEEEEEcCCeEEEEec
Confidence 222211111 1111011 1122222 11000 00001223344444 33 899999999999999999999
Q ss_pred CCCCccC
Q 036605 236 KTVSQDE 242 (340)
Q Consensus 236 ~~~~~~~ 242 (340)
.+.++..
T Consensus 259 PsL~~~~ 265 (282)
T PF15492_consen 259 PSLRLQR 265 (282)
T ss_pred Ccchhhc
Confidence 8866655
No 274
>KOG1409 consensus Uncharacterized conserved protein, contains WD40 repeats and FYVE domains [Function unknown]
Probab=98.86 E-value=1.1e-07 Score=77.53 Aligned_cols=202 Identities=10% Similarity=0.143 Sum_probs=131.9
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEcc-CCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVL-TGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMA 97 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~-~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i 97 (340)
++...|+....-|... -+++.+.|.+++||--. .++.-..+....+.+++++.+.++...|+.|-..|.+
T Consensus 22 G~~d~vn~~~l~~~e~---------gv~~~s~drtvrv~lkrds~q~wpsI~~~mP~~~~~~~y~~e~~~L~vg~~ngtv 92 (404)
T KOG1409|consen 22 GSQDDVNAAILIPKEE---------GVISVSEDRTVRVWLKRDSGQYWPSIYHYMPSPCSAMEYVSESRRLYVGQDNGTV 92 (404)
T ss_pred CchhhhhhheeccCCC---------CeEEccccceeeeEEeccccccCchhhhhCCCCceEeeeeccceEEEEEEecceE
Confidence 6667777766666665 69999999999999533 3432223332246788999999999999999889999
Q ss_pred EEEeCCC----CeEEEEeecCCCCeeEEEEccCCCEEEEecCc-------------------------------------
Q 036605 98 SEMKSEM----GEVIREFKASEKPISSSAFLCEEKIFALASSE------------------------------------- 136 (340)
Q Consensus 98 ~~wd~~~----~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~------------------------------------- 136 (340)
.-+.+.. ....+.+..|...+..+-|+.....+++.+.+
T Consensus 93 tefs~sedfnkm~~~r~~~~h~~~v~~~if~~~~e~V~s~~~dk~~~~hc~e~~~~lg~Y~~~~~~t~~~~d~~~~fvGd 172 (404)
T KOG1409|consen 93 TEFALSEDFNKMTFLKDYLAHQARVSAIVFSLTHEWVLSTGKDKQFAWHCTESGNRLGGYNFETPASALQFDALYAFVGD 172 (404)
T ss_pred EEEEhhhhhhhcchhhhhhhhhcceeeEEecCCceeEEEeccccceEEEeeccCCcccceEeeccCCCCceeeEEEEecc
Confidence 8876542 22233344566666666555444433332221
Q ss_pred -------EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeee
Q 036605 137 -------VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDC 209 (340)
Q Consensus 137 -------i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~ 209 (340)
+++.. ..-..+.++.+|.+.+.++.|.+....++++.. |..+.+||+....+.. .. ..+|...+..+
T Consensus 173 ~~gqvt~lr~~~-~~~~~i~~~~~h~~~~~~l~Wd~~~~~LfSg~~-d~~vi~wdigg~~g~~-~e---l~gh~~kV~~l 246 (404)
T KOG1409|consen 173 HSGQITMLKLEQ-NGCQLITTFNGHTGEVTCLKWDPGQRLLFSGAS-DHSVIMWDIGGRKGTA-YE---LQGHNDKVQAL 246 (404)
T ss_pred cccceEEEEEee-cCCceEEEEcCcccceEEEEEcCCCcEEEeccc-cCceEEEeccCCccee-ee---eccchhhhhhh
Confidence 11111 112345677889999999999999989999777 9999999994222211 11 11444444333
Q ss_pred ecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 210 KNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 210 ~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
.. -+--..+.+++.||.|-+|+.+..
T Consensus 247 --~~-~~~t~~l~S~~edg~i~~w~mn~~ 272 (404)
T KOG1409|consen 247 --SY-AQHTRQLISCGEDGGIVVWNMNVK 272 (404)
T ss_pred --hh-hhhheeeeeccCCCeEEEEeccce
Confidence 22 234467899999999999998763
No 275
>PF04762 IKI3: IKI3 family; InterPro: IPR006849 Members of this family are components of the elongator multi-subunit component of a novel RNA polymerase II holoenzyme for transcriptional elongation [].
Probab=98.86 E-value=4.1e-07 Score=87.69 Aligned_cols=200 Identities=14% Similarity=0.133 Sum_probs=123.5
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEcc-------------C----------CeeEEEecC-----
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVL-------------T----------GEMKWKSTG----- 70 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~-------------~----------~~~~~~~~~----- 70 (340)
..+..|.|++||||+. +|+..+.+|+|.+.+.. - |+....|.|
T Consensus 118 ~vd~GI~a~~WSPD~E---------lla~vT~~~~l~~mt~~fd~i~E~~l~~~~~~~~~~VsVGWGkKeTQF~Gs~gK~ 188 (928)
T PF04762_consen 118 SVDSGILAASWSPDEE---------LLALVTGEGNLLLMTRDFDPISEVPLDSDDFGESKHVSVGWGKKETQFHGSAGKA 188 (928)
T ss_pred EEcCcEEEEEECCCcC---------EEEEEeCCCEEEEEeccceEEEEeecCccccCCCceeeeccCcccCccCcchhhh
Confidence 4567899999999999 99999999999886421 0 111111111
Q ss_pred ------------------CCCCCeEEEEEecCCCEEEEEeC---C---CcEEEEeCCCCeEEEEeecCCCCeeEEEEccC
Q 036605 71 ------------------RHPGGLAGLAFAKKGRSLHVVGT---N---GMASEMKSEMGEVIREFKASEKPISSSAFLCE 126 (340)
Q Consensus 71 ------------------~h~~~v~~v~~~~~~~~l~s~~~---d---g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~ 126 (340)
.+...-..|+|-.||.++++.+- . ..++||+-+ |......+.-.+--.+++|.|.
T Consensus 189 aa~~~~~p~~~~~d~~~~s~dd~~~~ISWRGDG~yFAVss~~~~~~~~R~iRVy~Re-G~L~stSE~v~gLe~~l~WrPs 267 (928)
T PF04762_consen 189 AARQLRDPTVPKVDEGKLSWDDGRVRISWRGDGEYFAVSSVEPETGSRRVIRVYSRE-GELQSTSEPVDGLEGALSWRPS 267 (928)
T ss_pred hhhhccCCCCCccccCccccCCCceEEEECCCCcEEEEEEEEcCCCceeEEEEECCC-ceEEeccccCCCccCCccCCCC
Confidence 01224467889999999988764 2 478999965 6654444433334467899999
Q ss_pred CCEEEEecC-----cEEEEECCCCceeEEee----cCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCce
Q 036605 127 EKIFALASS-----EVRILSLENGEEVLKFS----DDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPA 197 (340)
Q Consensus 127 ~~~l~~~~~-----~i~i~d~~~~~~~~~~~----~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~ 197 (340)
|.++|+..+ +|.+|. ++|-.-..|. .....|..+.|++|+..|+.... | .|.+|-. ..........
T Consensus 268 G~lIA~~q~~~~~~~VvFfE-rNGLrhgeF~l~~~~~~~~v~~l~Wn~ds~iLAv~~~-~-~vqLWt~--~NYHWYLKqe 342 (928)
T PF04762_consen 268 GNLIASSQRLPDRHDVVFFE-RNGLRHGEFTLRFDPEEEKVIELAWNSDSEILAVWLE-D-RVQLWTR--SNYHWYLKQE 342 (928)
T ss_pred CCEEEEEEEcCCCcEEEEEe-cCCcEeeeEecCCCCCCceeeEEEECCCCCEEEEEec-C-CceEEEe--eCCEEEEEEE
Confidence 999988543 277776 4554444442 34567999999999998888554 4 4999987 2321111111
Q ss_pred eeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEEC
Q 036605 198 LSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDL 235 (340)
Q Consensus 198 ~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~ 235 (340)
+..........+ .|...+...|...+.+|.+..+++
T Consensus 343 i~~~~~~~~~~~--~Wdpe~p~~L~v~t~~g~~~~~~~ 378 (928)
T PF04762_consen 343 IRFSSSESVNFV--KWDPEKPLRLHVLTSNGQYEIYDF 378 (928)
T ss_pred EEccCCCCCCce--EECCCCCCEEEEEecCCcEEEEEE
Confidence 111111111112 453345566777776666655443
No 276
>KOG1275 consensus PAB-dependent poly(A) ribonuclease, subunit PAN2 [Replication, recombination and repair]
Probab=98.85 E-value=2e-07 Score=85.25 Aligned_cols=182 Identities=15% Similarity=0.190 Sum_probs=125.2
Q ss_pred CceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeE
Q 036605 41 GTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISS 120 (340)
Q Consensus 41 ~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~ 120 (340)
+...++.|+-...+..+|+.+.+..+...- ..+.|.-++- +++.+++|...|.|.+-|+.+.+.++++.+|.+.+..
T Consensus 146 ~~~~~i~Gg~Q~~li~~Dl~~~~e~r~~~v-~a~~v~imR~--Nnr~lf~G~t~G~V~LrD~~s~~~iht~~aHs~siSD 222 (1118)
T KOG1275|consen 146 GPSTLIMGGLQEKLIHIDLNTEKETRTTNV-SASGVTIMRY--NNRNLFCGDTRGTVFLRDPNSFETIHTFDAHSGSISD 222 (1118)
T ss_pred CCcceeecchhhheeeeecccceeeeeeec-cCCceEEEEe--cCcEEEeecccceEEeecCCcCceeeeeeccccceee
Confidence 334677777777888899988876655543 3335666664 4789999999999999999999999999999999987
Q ss_pred EEEccCCCEEEEecCc-----------EEEEECCCCceeEEeecCCCCeEEEEECCCC-CEEEEEEcCCCeEEEEEccCC
Q 036605 121 SAFLCEEKIFALASSE-----------VRILSLENGEEVLKFSDDVGPLQYVSASDGA-KIIITAGYGEKHLQVWRCDIS 188 (340)
Q Consensus 121 l~~~~~~~~l~~~~~~-----------i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~-~~l~s~~~~d~~i~iwd~~~~ 188 (340)
+.+ .|+.|++++.. |+|||++..+.+..+.-+.++ .-+.|.|.- ..++.++. .|...+-|.-.-
T Consensus 223 fDv--~GNlLitCG~S~R~~~l~~D~FvkVYDLRmmral~PI~~~~~P-~flrf~Psl~t~~~V~S~-sGq~q~vd~~~l 298 (1118)
T KOG1275|consen 223 FDV--QGNLLITCGYSMRRYNLAMDPFVKVYDLRMMRALSPIQFPYGP-QFLRFHPSLTTRLAVTSQ-SGQFQFVDTATL 298 (1118)
T ss_pred eec--cCCeEEEeecccccccccccchhhhhhhhhhhccCCcccccCc-hhhhhcccccceEEEEec-ccceeecccccc
Confidence 655 47888876543 889999988777665554444 556777753 34444455 788888883100
Q ss_pred CCCccCCcee-eecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEE
Q 036605 189 SKTVNKGPAL-SMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWD 234 (340)
Q Consensus 189 ~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd 234 (340)
+......... +.+..-..+++ ++++..++.|..+|.|.+|.
T Consensus 299 sNP~~~~~~v~p~~s~i~~fDi-----Ssn~~alafgd~~g~v~~wa 340 (1118)
T KOG1275|consen 299 SNPPAGVKMVNPNGSGISAFDI-----SSNGDALAFGDHEGHVNLWA 340 (1118)
T ss_pred CCCccceeEEccCCCcceeEEe-----cCCCceEEEecccCcEeeec
Confidence 1110111110 00111122333 88999999999999999997
No 277
>KOG4190 consensus Uncharacterized conserved protein [Function unknown]
Probab=98.85 E-value=1.1e-08 Score=88.53 Aligned_cols=197 Identities=10% Similarity=0.094 Sum_probs=133.4
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC-------CeeEEEecCCCCCCeEEEEEecCCCEEEEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT-------GEMKWKSTGRHPGGLAGLAFAKKGRSLHVV 91 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~-------~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~ 91 (340)
+|...|..++--.+.. -+++++.|.+|++|.++. ..+.++++. |+.+|.++.|-.+-+++++
T Consensus 733 GH~~~iRai~AidNEN---------SFiSASkDKTVKLWSik~EgD~~~tsaCQfTY~a-Hkk~i~~igfL~~lr~i~S- 801 (1034)
T KOG4190|consen 733 GHQEKIRAIAAIDNEN---------SFISASKDKTVKLWSIKPEGDEIGTSACQFTYQA-HKKPIHDIGFLADLRSIAS- 801 (1034)
T ss_pred CcHHHhHHHHhccccc---------ceeeccCCceEEEEEeccccCccccceeeeEhhh-ccCcccceeeeeccceeee-
Confidence 7777777776655554 599999999999999763 236677777 9999999999988877765
Q ss_pred eCCCcEEEEeCCCCeEEEEeec--CCCCeeEEEEccC-CCEEEEe----cCcEEEEECCCCceeEEeec-----CCCCeE
Q 036605 92 GTNGMASEMKSEMGEVIREFKA--SEKPISSSAFLCE-EKIFALA----SSEVRILSLENGEEVLKFSD-----DVGPLQ 159 (340)
Q Consensus 92 ~~dg~i~~wd~~~~~~~~~~~~--~~~~i~~l~~~~~-~~~l~~~----~~~i~i~d~~~~~~~~~~~~-----~~~~v~ 159 (340)
.||.|.+||.--|+++..+.. ..+.+..+..-|+ .+.++.+ ..+|+++|.+..+-...++. ....+.
T Consensus 802 -cD~giHlWDPFigr~Laq~~dapk~~a~~~ikcl~nv~~~iliAgcsaeSTVKl~DaRsce~~~E~kVcna~~Pna~~R 880 (1034)
T KOG4190|consen 802 -CDGGIHLWDPFIGRLLAQMEDAPKEGAGGNIKCLENVDRHILIAGCSAESTVKLFDARSCEWTCELKVCNAPGPNALTR 880 (1034)
T ss_pred -ccCcceeecccccchhHhhhcCcccCCCceeEecccCcchheeeeccchhhheeeecccccceeeEEeccCCCCchhee
Confidence 488999999988877654321 1222333333333 3334332 33499999999877766643 335688
Q ss_pred EEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEE-EECCC
Q 036605 160 YVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYS-WDLKT 237 (340)
Q Consensus 160 ~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~v-wd~~~ 237 (340)
+++..+.|++++++-+ .|.|.+.|.+ ++..+... .+...++.... .|..+.++....|..+.+ |....
T Consensus 881 ~iaVa~~GN~lAa~LS-nGci~~LDaR--~G~vINsw------rpmecdllqla-apsdq~L~~saldHslaVnWhald 949 (1034)
T KOG4190|consen 881 AIAVADKGNKLAAALS-NGCIAILDAR--NGKVINSW------RPMECDLLQLA-APSDQALAQSALDHSLAVNWHALD 949 (1034)
T ss_pred EEEeccCcchhhHHhc-CCcEEEEecC--CCceeccC------Ccccchhhhhc-CchhHHHHhhcccceeEeeehhcC
Confidence 9999999999999777 9999999984 33322211 11111221112 456677777778888888 76544
No 278
>KOG1832 consensus HIV-1 Vpr-binding protein [Cell cycle control, cell division, chromosome partitioning]
Probab=98.85 E-value=4.2e-09 Score=95.69 Aligned_cols=203 Identities=12% Similarity=0.188 Sum_probs=138.5
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCC--Cc
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTN--GM 96 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~d--g~ 96 (340)
.+....+|++|+-+.+ +|++|+..|.|++|++.+|.....+.. |.++|+-+.-+.+|..+++.+.- ..
T Consensus 1099 d~~~~fTc~afs~~~~---------hL~vG~~~Geik~~nv~sG~~e~s~nc-H~SavT~vePs~dgs~~Ltsss~S~Pl 1168 (1516)
T KOG1832|consen 1099 DETALFTCIAFSGGTN---------HLAVGSHAGEIKIFNVSSGSMEESVNC-HQSAVTLVEPSVDGSTQLTSSSSSSPL 1168 (1516)
T ss_pred ccccceeeEEeecCCc---------eEEeeeccceEEEEEccCccccccccc-cccccccccccCCcceeeeeccccCch
Confidence 5678899999998888 999999999999999999998888887 99999999999999987775543 34
Q ss_pred EEEEeCCC-CeEEEEeecCCCCeeEEEEccCC--CEEEEecCcEEEEECCCCceeEEe-e---cCCCCeEEEEECCCCCE
Q 036605 97 ASEMKSEM-GEVIREFKASEKPISSSAFLCEE--KIFALASSEVRILSLENGEEVLKF-S---DDVGPLQYVSASDGAKI 169 (340)
Q Consensus 97 i~~wd~~~-~~~~~~~~~~~~~i~~l~~~~~~--~~l~~~~~~i~i~d~~~~~~~~~~-~---~~~~~v~~~~~s~~~~~ 169 (340)
..+|++.. +.+.+.|.. -.++.|+... +.+.+......+||++++.++.++ . +....-+...|+|+...
T Consensus 1169 saLW~~~s~~~~~Hsf~e----d~~vkFsn~~q~r~~gt~~d~a~~YDvqT~~~l~tylt~~~~~~y~~n~a~FsP~D~L 1244 (1516)
T KOG1832|consen 1169 SALWDASSTGGPRHSFDE----DKAVKFSNSLQFRALGTEADDALLYDVQTCSPLQTYLTDTVTSSYSNNLAHFSPCDTL 1244 (1516)
T ss_pred HHHhccccccCccccccc----cceeehhhhHHHHHhcccccceEEEecccCcHHHHhcCcchhhhhhccccccCCCcce
Confidence 67898753 444455543 3566777653 233445555999999999877663 2 12223367889999987
Q ss_pred EEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC---CCCC
Q 036605 170 IITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE---KTNP 246 (340)
Q Consensus 170 l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~---~~~p 246 (340)
++- ||. +||+|.. +.+..+. .. .....-.| +|.|..++.-+ -|||+++-+.+. .+..
T Consensus 1245 Iln----dGv--LWDvR~~--~aIh~FD---~f---t~~~~G~F-HP~g~eVIINS-----EIwD~RTF~lLh~VP~Ldq 1304 (1516)
T KOG1832|consen 1245 ILN----DGV--LWDVRIP--EAIHRFD---QF---TDYGGGGF-HPSGNEVIINS-----EIWDMRTFKLLHSVPSLDQ 1304 (1516)
T ss_pred Eee----Cce--eeeeccH--HHHhhhh---hh---eecccccc-cCCCceEEeec-----hhhhhHHHHHHhcCccccc
Confidence 765 554 7999633 3233222 11 11122244 88888888754 479988855544 2333
Q ss_pred ceEEEeecc
Q 036605 247 AKITVKLKK 255 (340)
Q Consensus 247 ~~i~~~~~~ 255 (340)
+.+.+.+.+
T Consensus 1305 c~VtFNstG 1313 (1516)
T KOG1832|consen 1305 CAVTFNSTG 1313 (1516)
T ss_pred eEEEeccCc
Confidence 555555443
No 279
>PF07433 DUF1513: Protein of unknown function (DUF1513); InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=98.84 E-value=4.2e-06 Score=69.07 Aligned_cols=203 Identities=15% Similarity=0.152 Sum_probs=135.7
Q ss_pred CCeEEEEeeccc-cccccccCceEEEEEcCCCc-EEEEEccCCeeEEEecCCCCCCe--EEEEEecCCCEEEEEeCC---
Q 036605 22 VSYSCLACGFVG-KKRRKERGTLLLALGTSNGD-ILAVDVLTGEMKWKSTGRHPGGL--AGLAFAKKGRSLHVVGTN--- 94 (340)
Q Consensus 22 ~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~-i~i~d~~~~~~~~~~~~~h~~~v--~~v~~~~~~~~l~s~~~d--- 94 (340)
.....++.+|.. . .++.+-.-|+ ..+||..+++....+.. ..+.- -.-.|++||++||+.-.|
T Consensus 5 ~RgH~~a~~p~~~~---------avafaRRPG~~~~v~D~~~g~~~~~~~a-~~gRHFyGHg~fs~dG~~LytTEnd~~~ 74 (305)
T PF07433_consen 5 ARGHGVAAHPTRPE---------AVAFARRPGTFALVFDCRTGQLLQRLWA-PPGRHFYGHGVFSPDGRLLYTTENDYET 74 (305)
T ss_pred ccccceeeCCCCCe---------EEEEEeCCCcEEEEEEcCCCceeeEEcC-CCCCEEecCEEEcCCCCEEEEeccccCC
Confidence 455678888854 5 6777776665 56799999987776654 22222 245899999999997544
Q ss_pred --CcEEEEeCC-CCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--------------------EEEEECCCCceeEEe
Q 036605 95 --GMASEMKSE-MGEVIREFKASEKPISSSAFLCEEKIFALASSE--------------------VRILSLENGEEVLKF 151 (340)
Q Consensus 95 --g~i~~wd~~-~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--------------------i~i~d~~~~~~~~~~ 151 (340)
|.|-|||.. +-+.+.+|..+.-....+.+.|||+.|+++.+- +...|..+|+.+.+.
T Consensus 75 g~G~IgVyd~~~~~~ri~E~~s~GIGPHel~l~pDG~tLvVANGGI~Thpd~GR~kLNl~tM~psL~~ld~~sG~ll~q~ 154 (305)
T PF07433_consen 75 GRGVIGVYDAARGYRRIGEFPSHGIGPHELLLMPDGETLVVANGGIETHPDSGRAKLNLDTMQPSLVYLDARSGALLEQV 154 (305)
T ss_pred CcEEEEEEECcCCcEEEeEecCCCcChhhEEEcCCCCEEEEEcCCCccCcccCceecChhhcCCceEEEecCCCceeeee
Confidence 899999998 667778888888788999999999888774331 566778888887663
Q ss_pred ----ecCCCCeEEEEECCCCCEEEEEEcCCC-------eEEEEEccCCCCCccCCceee----ecCCCeeeeeecCCCCC
Q 036605 152 ----SDDVGPLQYVSASDGAKIIITAGYGEK-------HLQVWRCDISSKTVNKGPALS----MRHSPVAIDCKNSPNGE 216 (340)
Q Consensus 152 ----~~~~~~v~~~~~s~~~~~l~s~~~~d~-------~i~iwd~~~~~~~~~~~~~~~----~~~~~~~~~~~~~~~~~ 216 (340)
..|...+..+++.++|..++..-. .+ .|.+++- ++....+... ......+-++ ++ +.
T Consensus 155 ~Lp~~~~~lSiRHLa~~~~G~V~~a~Q~-qg~~~~~~PLva~~~~----g~~~~~~~~p~~~~~~l~~Y~gSI--a~-~~ 226 (305)
T PF07433_consen 155 ELPPDLHQLSIRHLAVDGDGTVAFAMQY-QGDPGDAPPLVALHRR----GGALRLLPAPEEQWRRLNGYIGSI--AA-DR 226 (305)
T ss_pred ecCccccccceeeEEecCCCcEEEEEec-CCCCCccCCeEEEEcC----CCcceeccCChHHHHhhCCceEEE--EE-eC
Confidence 337788999999999976555333 22 2444442 1111111100 0111222233 33 56
Q ss_pred CCCEE-EEEeCCCcEEEEECCCCCccC
Q 036605 217 DGTVI-LAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 217 ~~~~l-~~~s~dg~i~vwd~~~~~~~~ 242 (340)
++..+ +++-..|.+.+||..++..+.
T Consensus 227 ~g~~ia~tsPrGg~~~~~d~~tg~~~~ 253 (305)
T PF07433_consen 227 DGRLIAVTSPRGGRVAVWDAATGRLLG 253 (305)
T ss_pred CCCEEEEECCCCCEEEEEECCCCCEee
Confidence 77666 555567889999999988776
No 280
>KOG1354 consensus Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=98.84 E-value=1e-07 Score=77.83 Aligned_cols=158 Identities=9% Similarity=0.053 Sum_probs=112.5
Q ss_pred CCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEE---EecCC----CCCCeEEEEEecCC-CEEE
Q 036605 18 GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKW---KSTGR----HPGGLAGLAFAKKG-RSLH 89 (340)
Q Consensus 18 ~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~---~~~~~----h~~~v~~v~~~~~~-~~l~ 89 (340)
..|..-|.++.+..|+. .++++ .|=.|.+|+++-...-. .++.. -..-|++..|+|.. +.++
T Consensus 161 NaHtyhiNSIS~NsD~E---------t~lSA-DdLRINLWnlei~d~sFnIVDIKP~nmEeLteVITsaEFhp~~cn~f~ 230 (433)
T KOG1354|consen 161 NAHTYHINSISVNSDKE---------TFLSA-DDLRINLWNLEIIDQSFNIVDIKPANMEELTEVITSAEFHPHHCNVFV 230 (433)
T ss_pred ccceeEeeeeeecCccc---------eEeec-cceeeeeccccccCCceeEEEccccCHHHHHHHHhhhccCHhHccEEE
Confidence 46888999999999988 55554 67789999987543222 22220 12357888999954 4566
Q ss_pred EEeCCCcEEEEeCCCCeEE----EE------------eecCCCCeeEEEEccCCCEEEEecCc-EEEEEC-CCCceeEEe
Q 036605 90 VVGTNGMASEMKSEMGEVI----RE------------FKASEKPISSSAFLCEEKIFALASSE-VRILSL-ENGEEVLKF 151 (340)
Q Consensus 90 s~~~dg~i~~wd~~~~~~~----~~------------~~~~~~~i~~l~~~~~~~~l~~~~~~-i~i~d~-~~~~~~~~~ 151 (340)
..+..|.|++.|++..... .. |..--..|+.+.|+++|+++++-+.- |++||+ ...+++..+
T Consensus 231 YSSSKGtIrLcDmR~~aLCd~hsKlfEepedp~~rsffseiIsSISDvKFs~sGryilsRDyltvk~wD~nme~~pv~t~ 310 (433)
T KOG1354|consen 231 YSSSKGTIRLCDMRQSALCDAHSKLFEEPEDPSSRSFFSEIISSISDVKFSHSGRYILSRDYLTVKLWDLNMEAKPVETY 310 (433)
T ss_pred EecCCCcEEEeechhhhhhcchhhhhccccCCcchhhHHHHhhhhhceEEccCCcEEEEeccceeEEEeccccCCcceEE
Confidence 6678899999999853211 01 11122457889999999999998754 999999 445566666
Q ss_pred ecCC---------------CCeEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 152 SDDV---------------GPLQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 152 ~~~~---------------~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
+-|. ..-..++|+.++.++++|+. .+.+++|++.
T Consensus 311 ~vh~~lr~kLc~lYEnD~IfdKFec~~sg~~~~v~TGsy-~n~frvf~~~ 359 (433)
T KOG1354|consen 311 PVHEYLRSKLCSLYENDAIFDKFECSWSGNDSYVMTGSY-NNVFRVFNLA 359 (433)
T ss_pred eehHhHHHHHHHHhhccchhheeEEEEcCCcceEecccc-cceEEEecCC
Confidence 6554 12356788999999999888 8999999963
No 281
>KOG2695 consensus WD40 repeat protein [General function prediction only]
Probab=98.83 E-value=2e-08 Score=81.95 Aligned_cols=144 Identities=13% Similarity=0.166 Sum_probs=106.2
Q ss_pred EEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCC-----eEEEEeecCCCCeeE
Q 036605 46 ALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMG-----EVIREFKASEKPISS 120 (340)
Q Consensus 46 ~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~-----~~~~~~~~~~~~i~~ 120 (340)
++.+.+-.|.+-|+++|- ...|. ..+.|.++.|...++.++.|..+|.|..+|++.+ ...+.+ -|.+.|++
T Consensus 228 fs~G~sqqv~L~nvetg~-~qsf~--sksDVfAlQf~~s~nLv~~GcRngeI~~iDLR~rnqG~~~~a~rl-yh~Ssvts 303 (425)
T KOG2695|consen 228 FSVGLSQQVLLTNVETGH-QQSFQ--SKSDVFALQFAGSDNLVFNGCRNGEIFVIDLRCRNQGNGWCAQRL-YHDSSVTS 303 (425)
T ss_pred ecccccceeEEEEeeccc-ccccc--cchhHHHHHhcccCCeeEecccCCcEEEEEeeecccCCCcceEEE-EcCcchhh
Confidence 444556678888999884 33444 5678999999988999999999999999999875 233333 37788898
Q ss_pred EEEcc-CCCEEEE--ecCcEEEEECCCCce---eEEeecCCCCeEEEE--ECCCCCEEEEEEcCCCeEEEEEccCCCCCc
Q 036605 121 SAFLC-EEKIFAL--ASSEVRILSLENGEE---VLKFSDDVGPLQYVS--ASDGAKIIITAGYGEKHLQVWRCDISSKTV 192 (340)
Q Consensus 121 l~~~~-~~~~l~~--~~~~i~i~d~~~~~~---~~~~~~~~~~v~~~~--~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~ 192 (340)
+..-. ++++|.+ .++.|++||++--+. +..+.+|...-.-+- ..+....++++|. |...+||.+ ..+..
T Consensus 304 lq~Lq~s~q~LmaS~M~gkikLyD~R~~K~~~~V~qYeGHvN~~a~l~~~v~~eeg~I~s~Gd-DcytRiWsl--~~ghL 380 (425)
T KOG2695|consen 304 LQILQFSQQKLMASDMTGKIKLYDLRATKCKKSVMQYEGHVNLSAYLPAHVKEEEGSIFSVGD-DCYTRIWSL--DSGHL 380 (425)
T ss_pred hhhhccccceEeeccCcCceeEeeehhhhcccceeeeecccccccccccccccccceEEEccC-eeEEEEEec--ccCce
Confidence 88776 6777766 455599999986655 888888875444333 3566678888777 999999999 45544
Q ss_pred cCCc
Q 036605 193 NKGP 196 (340)
Q Consensus 193 ~~~~ 196 (340)
....
T Consensus 381 l~ti 384 (425)
T KOG2695|consen 381 LCTI 384 (425)
T ss_pred eecc
Confidence 4433
No 282
>COG4946 Uncharacterized protein related to the periplasmic component of the Tol biopolymer transport system [Function unknown]
Probab=98.81 E-value=2.5e-06 Score=72.87 Aligned_cols=168 Identities=14% Similarity=0.163 Sum_probs=121.7
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCC-cEEEEeCCCCeEEEEeecCCCCeeEEE
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNG-MASEMKSEMGEVIREFKASEKPISSSA 122 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg-~i~~wd~~~~~~~~~~~~~~~~i~~l~ 122 (340)
+++..+ .|...|.+...+-.+ .+ +|.+.|.-..+..+++-++.|..|| .+-++|..+++.. .+...-+.|.++.
T Consensus 334 ~ia~VS-RGkaFi~~~~~~~~i-qv--~~~~~VrY~r~~~~~e~~vigt~dgD~l~iyd~~~~e~k-r~e~~lg~I~av~ 408 (668)
T COG4946 334 YIALVS-RGKAFIMRPWDGYSI-QV--GKKGGVRYRRIQVDPEGDVIGTNDGDKLGIYDKDGGEVK-RIEKDLGNIEAVK 408 (668)
T ss_pred EEEEEe-cCcEEEECCCCCeeE-Ec--CCCCceEEEEEccCCcceEEeccCCceEEEEecCCceEE-EeeCCccceEEEE
Confidence 566554 567777776655433 22 3778899999988888999999998 8999999988754 4555677899999
Q ss_pred EccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEc---CCCeEEEEEccCCCCCccCCce
Q 036605 123 FLCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGY---GEKHLQVWRCDISSKTVNKGPA 197 (340)
Q Consensus 123 ~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~---~d~~i~iwd~~~~~~~~~~~~~ 197 (340)
.+|+|+.++++... +.++|+.++.....-+...+-|+...|+|++++++-+-- -...|+++|+ ..++.....
T Consensus 409 vs~dGK~~vvaNdr~el~vididngnv~~idkS~~~lItdf~~~~nsr~iAYafP~gy~tq~Iklydm--~~~Kiy~vT- 485 (668)
T COG4946 409 VSPDGKKVVVANDRFELWVIDIDNGNVRLIDKSEYGLITDFDWHPNSRWIAYAFPEGYYTQSIKLYDM--DGGKIYDVT- 485 (668)
T ss_pred EcCCCcEEEEEcCceEEEEEEecCCCeeEecccccceeEEEEEcCCceeEEEecCcceeeeeEEEEec--CCCeEEEec-
Confidence 99999999887776 888899999655444556688999999999999987544 1346899998 343332211
Q ss_pred eeecCCCeeeeeecCCCCCCCCEEEEEe
Q 036605 198 LSMRHSPVAIDCKNSPNGEDGTVILAVA 225 (340)
Q Consensus 198 ~~~~~~~~~~~~~~~~~~~~~~~l~~~s 225 (340)
.+...+...+| .|++.+|..-+
T Consensus 486 -----T~ta~DfsPaF-D~d~ryLYfLs 507 (668)
T COG4946 486 -----TPTAYDFSPAF-DPDGRYLYFLS 507 (668)
T ss_pred -----CCcccccCccc-CCCCcEEEEEe
Confidence 22233444466 78888876654
No 283
>PF00400 WD40: WD domain, G-beta repeat; InterPro: IPR019781 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events.; PDB: 2ZKQ_a 3CFV_B 3CFS_B 1PEV_A 1NR0_A 1VYH_T 3RFH_A 3O2Z_T 3FRX_C 3U5G_g ....
Probab=98.80 E-value=2.1e-08 Score=56.66 Aligned_cols=38 Identities=16% Similarity=0.268 Sum_probs=35.6
Q ss_pred eeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEe
Q 036605 63 EMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMK 101 (340)
Q Consensus 63 ~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd 101 (340)
+.+..+.+ |.+.|++++|+|++..|++++.|+.|++||
T Consensus 2 ~~~~~~~~-h~~~i~~i~~~~~~~~~~s~~~D~~i~vwd 39 (39)
T PF00400_consen 2 KCVRTFRG-HSSSINSIAWSPDGNFLASGSSDGTIRVWD 39 (39)
T ss_dssp EEEEEEES-SSSSEEEEEEETTSSEEEEEETTSEEEEEE
T ss_pred eEEEEEcC-CCCcEEEEEEecccccceeeCCCCEEEEEC
Confidence 56778888 999999999999999999999999999997
No 284
>KOG4532 consensus WD40-like repeat containing protein [General function prediction only]
Probab=98.78 E-value=2e-06 Score=68.21 Aligned_cols=198 Identities=10% Similarity=-0.003 Sum_probs=118.0
Q ss_pred ceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecC-CCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeE
Q 036605 42 TLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKK-GRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISS 120 (340)
Q Consensus 42 ~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~-~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~ 120 (340)
+.+||.|+..|...+|...+.+....+-..|...|+-+.=..+ ...+..++.|.++++.++.-+..........-.+.+
T Consensus 84 c~~la~gG~~g~fd~~~~~tn~~h~~~cd~snn~v~~~~r~cd~~~~~~i~sndht~k~~~~~~~s~~~~~h~~~~~~ns 163 (344)
T KOG4532|consen 84 CVTLADGGASGQFDLFACNTNDGHLYQCDVSNNDVTLVKRYCDLKFPLNIASNDHTGKTMVVSGDSNKFAVHNQNLTQNS 163 (344)
T ss_pred ccEEEeccccceeeeecccCcccceeeecccccchhhhhhhcccccceeeccCCcceeEEEEecCcccceeeccccceee
Confidence 4589999999999999988765333322224433322211111 224666788888888877655433333222233788
Q ss_pred EEEccCCCEEEEecCc--EEEEECCCC-cee-EEe-ecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCC
Q 036605 121 SAFLCEEKIFALASSE--VRILSLENG-EEV-LKF-SDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKG 195 (340)
Q Consensus 121 l~~~~~~~~l~~~~~~--i~i~d~~~~-~~~-~~~-~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~ 195 (340)
+++++|++++++.+.. |..|.+... +.+ ... ......--+..|+.....++++.. ||++.|||+|.. +.....
T Consensus 164 ~~~snd~~~~~~Vgds~~Vf~y~id~~sey~~~~~~a~t~D~gF~~S~s~~~~~FAv~~Q-dg~~~I~DVR~~-~tpm~~ 241 (344)
T KOG4532|consen 164 LHYSNDPSWGSSVGDSRRVFRYAIDDESEYIENIYEAPTSDHGFYNSFSENDLQFAVVFQ-DGTCAIYDVRNM-ATPMAE 241 (344)
T ss_pred eEEcCCCceEEEecCCCcceEEEeCCccceeeeeEecccCCCceeeeeccCcceEEEEec-CCcEEEEEeccc-ccchhh
Confidence 9999999999885544 888887543 222 212 222334456788888888888776 999999999732 222222
Q ss_pred ceeee-cCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 196 PALSM-RHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 196 ~~~~~-~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
..-+- .|...+..+......+. .+|+..-.-+.+.+.|++++....
T Consensus 242 ~sstrp~hnGa~R~c~Fsl~g~l-DLLf~sEhfs~~hv~D~R~~~~~q 288 (344)
T KOG4532|consen 242 ISSTRPHHNGAFRVCRFSLYGLL-DLLFISEHFSRVHVVDTRNYVNHQ 288 (344)
T ss_pred hcccCCCCCCceEEEEecCCCcc-eEEEEecCcceEEEEEcccCceee
Confidence 11111 34444554422211222 234444456789999999876655
No 285
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=98.77 E-value=5.6e-06 Score=72.96 Aligned_cols=181 Identities=15% Similarity=0.153 Sum_probs=109.4
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCe-----EEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCC--
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGL-----AGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEK-- 116 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v-----~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~-- 116 (340)
.++.++.+|.|+.||.++|+.++++.. ....+ ...... +..++.+..++.+..+|+.+|+.+........
T Consensus 147 ~v~v~~~~g~l~a~d~~tG~~~W~~~~-~~~~~~~~~~~sp~~~--~~~v~~~~~~g~v~ald~~tG~~~W~~~~~~~~g 223 (377)
T TIGR03300 147 LVVVRTNDGRLTALDAATGERLWTYSR-VTPALTLRGSASPVIA--DGGVLVGFAGGKLVALDLQTGQPLWEQRVALPKG 223 (377)
T ss_pred EEEEECCCCeEEEEEcCCCceeeEEcc-CCCceeecCCCCCEEE--CCEEEEECCCCEEEEEEccCCCEeeeeccccCCC
Confidence 577788899999999999998888764 22111 111222 34778888889999999999987655331100
Q ss_pred --C------e-eEEEEccCCCEEEE-ecCcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 117 --P------I-SSSAFLCEEKIFAL-ASSEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 117 --~------i-~~l~~~~~~~~l~~-~~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
. + ....+. ++..++. .++.++.||..+++.+..... . ....+.. ++..++.+.. ++.+..+|.
T Consensus 224 ~~~~~~~~~~~~~p~~~-~~~vy~~~~~g~l~a~d~~tG~~~W~~~~-~-~~~~p~~--~~~~vyv~~~-~G~l~~~d~- 296 (377)
T TIGR03300 224 RTELERLVDVDGDPVVD-GGQVYAVSYQGRVAALDLRSGRVLWKRDA-S-SYQGPAV--DDNRLYVTDA-DGVVVALDR- 296 (377)
T ss_pred CCchhhhhccCCccEEE-CCEEEEEEcCCEEEEEECCCCcEEEeecc-C-CccCceE--eCCEEEEECC-CCeEEEEEC-
Confidence 0 0 111122 2333333 455699999999987655431 1 1122222 3456777666 899999998
Q ss_pred CCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 187 ISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 187 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
.+++...... .+... ... .. ...+..+++++.+|.|+++|..+++.+.
T Consensus 297 -~tG~~~W~~~-~~~~~--~~s---sp-~i~g~~l~~~~~~G~l~~~d~~tG~~~~ 344 (377)
T TIGR03300 297 -RSGSELWKND-ELKYR--QLT---AP-AVVGGYLVVGDFEGYLHWLSREDGSFVA 344 (377)
T ss_pred -CCCcEEEccc-cccCC--ccc---cC-EEECCEEEEEeCCCEEEEEECCCCCEEE
Confidence 4554322111 00110 000 11 1235688999999999999998887765
No 286
>KOG2695 consensus WD40 repeat protein [General function prediction only]
Probab=98.76 E-value=3.2e-08 Score=80.75 Aligned_cols=123 Identities=15% Similarity=0.148 Sum_probs=95.7
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCC-----eeEEEecCCCCCCeEEEEEec-CCCEEEEEeC
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTG-----EMKWKSTGRHPGGLAGLAFAK-KGRSLHVVGT 93 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~-----~~~~~~~~~h~~~v~~v~~~~-~~~~l~s~~~ 93 (340)
-++.|.++.|...+. ++..|+.+|.|..+|++.+ .....+. |...|+++..-. ++++|++.+.
T Consensus 251 sksDVfAlQf~~s~n---------Lv~~GcRngeI~~iDLR~rnqG~~~~a~rly--h~Ssvtslq~Lq~s~q~LmaS~M 319 (425)
T KOG2695|consen 251 SKSDVFALQFAGSDN---------LVFNGCRNGEIFVIDLRCRNQGNGWCAQRLY--HDSSVTSLQILQFSQQKLMASDM 319 (425)
T ss_pred cchhHHHHHhcccCC---------eeEecccCCcEEEEEeeecccCCCcceEEEE--cCcchhhhhhhccccceEeeccC
Confidence 356788888887777 8999999999999999865 2444555 899999998766 7889999999
Q ss_pred CCcEEEEeCCCCeE---EEEeecCCCCeeE--EEEccCCCEEEEecCc--EEEEECCCCceeEEeec
Q 036605 94 NGMASEMKSEMGEV---IREFKASEKPISS--SAFLCEEKIFALASSE--VRILSLENGEEVLKFSD 153 (340)
Q Consensus 94 dg~i~~wd~~~~~~---~~~~~~~~~~i~~--l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~ 153 (340)
+|.|++||.+.-+. +..+.+|...-.- +-+.+....+++++.+ .+||.++.+..+.+++.
T Consensus 320 ~gkikLyD~R~~K~~~~V~qYeGHvN~~a~l~~~v~~eeg~I~s~GdDcytRiWsl~~ghLl~tipf 386 (425)
T KOG2695|consen 320 TGKIKLYDLRATKCKKSVMQYEGHVNLSAYLPAHVKEEEGSIFSVGDDCYTRIWSLDSGHLLCTIPF 386 (425)
T ss_pred cCceeEeeehhhhcccceeeeecccccccccccccccccceEEEccCeeEEEEEecccCceeeccCC
Confidence 99999999987665 7778887543322 3345666777776666 89999999988876643
No 287
>PF04762 IKI3: IKI3 family; InterPro: IPR006849 Members of this family are components of the elongator multi-subunit component of a novel RNA polymerase II holoenzyme for transcriptional elongation [].
Probab=98.75 E-value=1.7e-06 Score=83.54 Aligned_cols=197 Identities=15% Similarity=0.150 Sum_probs=131.3
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCCCcEEEE----EccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCc
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAV----DVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGM 96 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~----d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~ 96 (340)
...|.++.+-++.. .++.+..+|.|.++ +..+.. ...-+.-...|.+++||||+..|+....++.
T Consensus 75 ~~~ivs~~yl~d~~---------~l~~~~~~Gdi~~~~~~~~~~~~~--~E~VG~vd~GI~a~~WSPD~Ella~vT~~~~ 143 (928)
T PF04762_consen 75 NDKIVSFQYLADSE---------SLCIALASGDIILVREDPDPDEDE--IEIVGSVDSGILAASWSPDEELLALVTGEGN 143 (928)
T ss_pred CCcEEEEEeccCCC---------cEEEEECCceEEEEEccCCCCCce--eEEEEEEcCcEEEEEECCCcCEEEEEeCCCE
Confidence 36788888888887 69999999999999 544443 2222224568999999999999999998988
Q ss_pred EEEEeCCCCeEE------------------------EEeec------------------------CCCCeeEEEEccCCC
Q 036605 97 ASEMKSEMGEVI------------------------REFKA------------------------SEKPISSSAFLCEEK 128 (340)
Q Consensus 97 i~~wd~~~~~~~------------------------~~~~~------------------------~~~~i~~l~~~~~~~ 128 (340)
+.+.+-. ..++ ..|.+ ....-..|+|-.||.
T Consensus 144 l~~mt~~-fd~i~E~~l~~~~~~~~~~VsVGWGkKeTQF~Gs~gK~aa~~~~~p~~~~~d~~~~s~dd~~~~ISWRGDG~ 222 (928)
T PF04762_consen 144 LLLMTRD-FDPISEVPLDSDDFGESKHVSVGWGKKETQFHGSAGKAAARQLRDPTVPKVDEGKLSWDDGRVRISWRGDGE 222 (928)
T ss_pred EEEEecc-ceEEEEeecCccccCCCceeeeccCcccCccCcchhhhhhhhccCCCCCccccCccccCCCceEEEECCCCc
Confidence 8876521 1111 11110 111335788999999
Q ss_pred EEEEe------c--CcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcC--CCeEEEEEccCCCCCccCCcee
Q 036605 129 IFALA------S--SEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYG--EKHLQVWRCDISSKTVNKGPAL 198 (340)
Q Consensus 129 ~l~~~------~--~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~--d~~i~iwd~~~~~~~~~~~~~~ 198 (340)
++|+. + +.+++|+-+ |.....-..-.+--..++|.|.|..|++.... ...|.+|. ..|.....+.+
T Consensus 223 yFAVss~~~~~~~~R~iRVy~Re-G~L~stSE~v~gLe~~l~WrPsG~lIA~~q~~~~~~~VvFfE---rNGLrhgeF~l 298 (928)
T PF04762_consen 223 YFAVSSVEPETGSRRVIRVYSRE-GELQSTSEPVDGLEGALSWRPSGNLIASSQRLPDRHDVVFFE---RNGLRHGEFTL 298 (928)
T ss_pred EEEEEEEEcCCCceeEEEEECCC-ceEEeccccCCCccCCccCCCCCCEEEEEEEcCCCcEEEEEe---cCCcEeeeEec
Confidence 99772 2 239999954 54333323333444678999999988886553 24566666 34555555555
Q ss_pred ee-cCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 199 SM-RHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 199 ~~-~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
.. .....+..+ .| +.++..|+....|. |.+|-..+
T Consensus 299 ~~~~~~~~v~~l--~W-n~ds~iLAv~~~~~-vqLWt~~N 334 (928)
T PF04762_consen 299 RFDPEEEKVIEL--AW-NSDSEILAVWLEDR-VQLWTRSN 334 (928)
T ss_pred CCCCCCceeeEE--EE-CCCCCEEEEEecCC-ceEEEeeC
Confidence 44 223345555 77 89999999888776 99997776
No 288
>PF00400 WD40: WD domain, G-beta repeat; InterPro: IPR019781 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events.; PDB: 2ZKQ_a 3CFV_B 3CFS_B 1PEV_A 1NR0_A 1VYH_T 3RFH_A 3O2Z_T 3FRX_C 3U5G_g ....
Probab=98.75 E-value=3.4e-08 Score=55.80 Aligned_cols=39 Identities=28% Similarity=0.393 Sum_probs=35.8
Q ss_pred CceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEE
Q 036605 7 GSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVD 58 (340)
Q Consensus 7 g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d 58 (340)
|+++..+. +|...|++|+|+|++. +|++|+.|+.|++||
T Consensus 1 g~~~~~~~----~h~~~i~~i~~~~~~~---------~~~s~~~D~~i~vwd 39 (39)
T PF00400_consen 1 GKCVRTFR----GHSSSINSIAWSPDGN---------FLASGSSDGTIRVWD 39 (39)
T ss_dssp EEEEEEEE----SSSSSEEEEEEETTSS---------EEEEEETTSEEEEEE
T ss_pred CeEEEEEc----CCCCcEEEEEEecccc---------cceeeCCCCEEEEEC
Confidence 45677888 8999999999999999 999999999999997
No 289
>KOG1912 consensus WD40 repeat protein [General function prediction only]
Probab=98.70 E-value=1.6e-06 Score=78.20 Aligned_cols=211 Identities=14% Similarity=0.102 Sum_probs=137.6
Q ss_pred CCCCCeEEEEeecccccccc---ccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEec---CC-CEEEEE
Q 036605 19 EPVVSYSCLACGFVGKKRRK---ERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAK---KG-RSLHVV 91 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~---~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~---~~-~~l~s~ 91 (340)
.|...|+.+.|.|-...|.- .....+||++.-.|.|.+||...+..+..+.. |..++..++|-+ +. ..|+.-
T Consensus 53 ~h~s~V~~VrWap~~~p~~llS~~~~~lliAsaD~~GrIil~d~~~~s~~~~l~~-~~~~~qdl~W~~~rd~Srd~LlaI 131 (1062)
T KOG1912|consen 53 LHQSAVTSVRWAPAPSPRDLLSPSSSQLLIASADISGRIILVDFVLASVINWLSH-SNDSVQDLCWVPARDDSRDVLLAI 131 (1062)
T ss_pred cCccceeEEEeccCCCchhccCccccceeEEeccccCcEEEEEehhhhhhhhhcC-CCcchhheeeeeccCcchheeEEe
Confidence 88999999999987643321 22456888899999999999999988888887 889999999976 23 356666
Q ss_pred eCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEcc-CCCEEEE-ecCc-EEEEEC-CC------CceeEEeecCCC-----
Q 036605 92 GTNGMASEMKSEMGEVIREFKASEKPISSSAFLC-EEKIFAL-ASSE-VRILSL-EN------GEEVLKFSDDVG----- 156 (340)
Q Consensus 92 ~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~-~~~~l~~-~~~~-i~i~d~-~~------~~~~~~~~~~~~----- 156 (340)
.....+.+|+..+|+...+.........|+.+.| |.+++.. +.+. +.+-+. .. ++..+.-..|..
T Consensus 132 h~ss~lvLwntdtG~k~Wk~~ys~~iLs~f~~DPfd~rh~~~l~s~g~vl~~~~l~~sep~~pgk~~qI~sd~Sdl~~le 211 (1062)
T KOG1912|consen 132 HGSSTLVLWNTDTGEKFWKYDYSHEILSCFRVDPFDSRHFCVLGSKGFVLSCKDLGLSEPDVPGKEFQITSDHSDLAHLE 211 (1062)
T ss_pred cCCcEEEEEEccCCceeeccccCCcceeeeeeCCCCcceEEEEccCceEEEEeccCCCCCCCCceeEEEecCccchhhhh
Confidence 6778999999999999888877777788888888 3344433 3322 333332 11 111111111111
Q ss_pred --------------------CeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCC
Q 036605 157 --------------------PLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGE 216 (340)
Q Consensus 157 --------------------~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 216 (340)
....++|+|.-+.++.... .+.+.|+|+... .......++-+ ...+.++ .. .+
T Consensus 212 re~at~ns~ts~~~sa~fity~a~faf~p~~rn~lfi~~-prellv~dle~~--~~l~vvpier~-~akfv~v--lP-~~ 284 (1062)
T KOG1912|consen 212 RETATGNSTTSTPASAYFITYCAQFAFSPHWRNILFITF-PRELLVFDLEYE--CCLAVVPIERG-GAKFVDV--LP-DP 284 (1062)
T ss_pred hhhhccccccCCCcchhHHHHHHhhhcChhhhceEEEEe-ccceEEEcchhh--ceeEEEEeccC-CcceeEe--cc-CC
Confidence 1233566887666666567 789999998422 22222221111 1224444 22 45
Q ss_pred CCCEEEEEeCCCcEEEEECCC
Q 036605 217 DGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 217 ~~~~l~~~s~dg~i~vwd~~~ 237 (340)
....|+++-.||.+.+|--+.
T Consensus 285 ~rd~LfclH~nG~ltirvrk~ 305 (1062)
T KOG1912|consen 285 RRDALFCLHSNGRLTIRVRKE 305 (1062)
T ss_pred CcceEEEEecCCeEEEEEeec
Confidence 556799999999999997655
No 290
>PLN02919 haloacid dehalogenase-like hydrolase family protein
Probab=98.70 E-value=5.8e-06 Score=81.41 Aligned_cols=151 Identities=7% Similarity=0.070 Sum_probs=102.3
Q ss_pred eEEEEeecc-ccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecC--------CC------CCCeEEEEEecCCCEE
Q 036605 24 YSCLACGFV-GKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTG--------RH------PGGLAGLAFAKKGRSL 88 (340)
Q Consensus 24 v~~l~~sp~-~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~--------~h------~~~v~~v~~~~~~~~l 88 (340)
-..++|+|+ +. ++++.+.++.|++||..++... .+.+ .+ -.....|+|+|+++.|
T Consensus 685 P~gVa~dp~~g~---------LyVad~~~~~I~v~d~~~g~v~-~~~G~G~~~~~~g~~~~~~~~~~P~GIavspdG~~L 754 (1057)
T PLN02919 685 PWDVCFEPVNEK---------VYIAMAGQHQIWEYNISDGVTR-VFSGDGYERNLNGSSGTSTSFAQPSGISLSPDLKEL 754 (1057)
T ss_pred CeEEEEecCCCe---------EEEEECCCCeEEEEECCCCeEE-EEecCCccccCCCCccccccccCccEEEEeCCCCEE
Confidence 357899994 56 7778888899999998877533 2211 01 1234679999999866
Q ss_pred EEEe-CCCcEEEEeCCCCeEEEEeec-------------C--------CCCeeEEEEccCCCEEEEe--cCcEEEEECCC
Q 036605 89 HVVG-TNGMASEMKSEMGEVIREFKA-------------S--------EKPISSSAFLCEEKIFALA--SSEVRILSLEN 144 (340)
Q Consensus 89 ~s~~-~dg~i~~wd~~~~~~~~~~~~-------------~--------~~~i~~l~~~~~~~~l~~~--~~~i~i~d~~~ 144 (340)
+.+. .++.|++||+.++.......+ . -.....++++++|.++++. ++.|++||..+
T Consensus 755 YVADs~n~~Irv~D~~tg~~~~~~gg~~~~~~~l~~fG~~dG~g~~~~l~~P~Gvavd~dG~LYVADs~N~rIrviD~~t 834 (1057)
T PLN02919 755 YIADSESSSIRALDLKTGGSRLLAGGDPTFSDNLFKFGDHDGVGSEVLLQHPLGVLCAKDGQIYVADSYNHKIKKLDPAT 834 (1057)
T ss_pred EEEECCCCeEEEEECCCCcEEEEEecccccCcccccccCCCCchhhhhccCCceeeEeCCCcEEEEECCCCEEEEEECCC
Confidence 6654 568999999987653211100 0 0124688999999876663 44499999988
Q ss_pred CceeEEeec--------------CCCCeEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 145 GEEVLKFSD--------------DVGPLQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 145 ~~~~~~~~~--------------~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
+... .+.+ .-.....++++++|+.+++ ...++.|++||++
T Consensus 835 g~v~-tiaG~G~~G~~dG~~~~a~l~~P~GIavd~dG~lyVa-Dt~Nn~Irvid~~ 888 (1057)
T PLN02919 835 KRVT-TLAGTGKAGFKDGKALKAQLSEPAGLALGENGRLFVA-DTNNSLIRYLDLN 888 (1057)
T ss_pred CeEE-EEeccCCcCCCCCcccccccCCceEEEEeCCCCEEEE-ECCCCEEEEEECC
Confidence 7543 2211 1124678999999986666 4559999999983
No 291
>KOG4714 consensus Nucleoporin [Nuclear structure]
Probab=98.69 E-value=1.7e-07 Score=73.71 Aligned_cols=198 Identities=9% Similarity=0.103 Sum_probs=117.1
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCee------------EEEecCCCCCCeEEEEEecCCCEEEE
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEM------------KWKSTGRHPGGLAGLAFAKKGRSLHV 90 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~------------~~~~~~~h~~~v~~v~~~~~~~~l~s 90 (340)
.++.+.++-+. .|+++..++.+..+..-++.+ .+.+.. |+++-.+-+.+-.++.+++
T Consensus 38 ~~~~~~~v~~~----------~lf~~e~~~~~ss~g~~r~~~~~~~~rt~~i~~~~~~a~-~sep~p~~~~s~~~t~V~~ 106 (319)
T KOG4714|consen 38 KLSKVSLSAEY----------ILFTGETSSQIISLGKGRGRCISLWERDDGIDPFKVLAK-NSEIDPNDACTMTDNRVCI 106 (319)
T ss_pred EEEEeechhhh----------eeecccchhheeeeccceEEEechhhcccCcCceeeeec-cCCCCCcccccccCCceEe
Confidence 35666665433 478887777776665433322 233332 4443333333334677899
Q ss_pred EeCCCcEEEEeCCCCeEE-EEeecCCCCeeEEEEccCCCEEEEe-------cCcEEEEECCCCceeEEeecCCCCeEEEE
Q 036605 91 VGTNGMASEMKSEMGEVI-REFKASEKPISSSAFLCEEKIFALA-------SSEVRILSLENGEEVLKFSDDVGPLQYVS 162 (340)
Q Consensus 91 ~~~dg~i~~wd~~~~~~~-~~~~~~~~~i~~l~~~~~~~~l~~~-------~~~i~i~d~~~~~~~~~~~~~~~~v~~~~ 162 (340)
+..||.+.+++.+.-..+ .+.......-.+.++...+..+.++ -+..+.|+++..+.+..-......|++++
T Consensus 107 ~~~dg~~~v~s~~~~~~~~~~i~~~~~~~as~~~~~~~~~i~s~~~g~~n~~d~~~a~~~~p~~t~~~~~~~~~~v~~l~ 186 (319)
T KOG4714|consen 107 GYADGSLAVFSTDKDLALMSRIPSIHSGSASRKICRHGNSILSGGCGNWNAQDNFYANTLDPIKTLIPSKKALDAVTALC 186 (319)
T ss_pred cCCCceEEEEechHHHhhhhhcccccccccccceeecccEEecCCcceEeeccceeeecccccccccccccccccchhhh
Confidence 999999999987641111 1111111111223333444444442 22377788765543322111223488999
Q ss_pred ECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 163 ASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 163 ~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
-+|..+.++.++.+||.+-+||.|.- . -...+...|...+..+ .|...++..|+++++||.+..||..+
T Consensus 187 ~hp~qq~~v~cgt~dg~~~l~d~rn~--~--~p~S~l~ahk~~i~eV--~FHpk~p~~Lft~sedGslw~wdas~ 255 (319)
T KOG4714|consen 187 SHPAQQHLVCCGTDDGIVGLWDARNV--A--MPVSLLKAHKAEIWEV--HFHPKNPEHLFTCSEDGSLWHWDAST 255 (319)
T ss_pred CCcccccEEEEecCCCeEEEEEcccc--c--chHHHHHHhhhhhhhe--eccCCCchheeEecCCCcEEEEcCCC
Confidence 99998888888888999999999622 1 1112222555555555 55567888999999999999999875
No 292
>KOG2314 consensus Translation initiation factor 3, subunit b (eIF-3b) [Translation, ribosomal structure and biogenesis]
Probab=98.68 E-value=9.3e-07 Score=76.76 Aligned_cols=178 Identities=15% Similarity=0.066 Sum_probs=120.0
Q ss_pred EEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCC----------
Q 036605 25 SCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTN---------- 94 (340)
Q Consensus 25 ~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~d---------- 94 (340)
+-+.|||-|. ||++--.-| |.+|--++-...+++. |+ .|.-+.|||..++|++-+..
T Consensus 214 tyv~wSP~GT---------YL~t~Hk~G-I~lWGG~~f~r~~RF~--Hp-~Vq~idfSP~EkYLVT~s~~p~~~~~~d~e 280 (698)
T KOG2314|consen 214 TYVRWSPKGT---------YLVTFHKQG-IALWGGESFDRIQRFY--HP-GVQFIDFSPNEKYLVTYSPEPIIVEEDDNE 280 (698)
T ss_pred eeEEecCCce---------EEEEEeccc-eeeecCccHHHHHhcc--CC-CceeeecCCccceEEEecCCccccCcccCC
Confidence 5688999999 899887776 8899766655666666 76 68999999999999996531
Q ss_pred -CcEEEEeCCCCeEEEEeecC--CCCe-eEEEEccCCCEEEEecCc-EEEEECCCCceeEEeecCCCCeEEEEECCCCCE
Q 036605 95 -GMASEMKSEMGEVIREFKAS--EKPI-SSSAFLCEEKIFALASSE-VRILSLENGEEVLKFSDDVGPLQYVSASDGAKI 169 (340)
Q Consensus 95 -g~i~~wd~~~~~~~~~~~~~--~~~i-~~l~~~~~~~~l~~~~~~-i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~ 169 (340)
..+++||+.+|.....|... ...+ .-+.||.|++++|....+ |.||+..+-..+-.-......|....|+|.+..
T Consensus 281 ~~~l~IWDI~tG~lkrsF~~~~~~~~~WP~frWS~DdKy~Arm~~~sisIyEtpsf~lld~Kslki~gIr~FswsP~~~l 360 (698)
T KOG2314|consen 281 GQQLIIWDIATGLLKRSFPVIKSPYLKWPIFRWSHDDKYFARMTGNSISIYETPSFMLLDKKSLKISGIRDFSWSPTSNL 360 (698)
T ss_pred CceEEEEEccccchhcceeccCCCccccceEEeccCCceeEEeccceEEEEecCceeeecccccCCccccCcccCCCcce
Confidence 47899999999988887762 2222 346799999999985555 999998765443222223467888999999877
Q ss_pred EEEEEcCC----CeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEE
Q 036605 170 IITAGYGE----KHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILA 223 (340)
Q Consensus 170 l~s~~~~d----~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~ 223 (340)
|+.-.... ..+.+-.+ ++++.++... --.+.++...| ..+|.+|+.
T Consensus 361 lAYwtpe~~~~parvtL~ev--Ps~~~iRt~n-----lfnVsDckLhW-Qk~gdyLcv 410 (698)
T KOG2314|consen 361 LAYWTPETNNIPARVTLMEV--PSKREIRTKN-----LFNVSDCKLHW-QKSGDYLCV 410 (698)
T ss_pred EEEEcccccCCcceEEEEec--Cccceeeecc-----ceeeeccEEEe-ccCCcEEEE
Confidence 76543321 23455555 3433332221 11233444455 566666654
No 293
>KOG2314 consensus Translation initiation factor 3, subunit b (eIF-3b) [Translation, ribosomal structure and biogenesis]
Probab=98.67 E-value=6.2e-06 Score=71.82 Aligned_cols=219 Identities=10% Similarity=0.078 Sum_probs=138.7
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA 80 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~ 80 (340)
|||..+|.+.+.|... ......-.-..||.|++ |+|--.. ..|.||+.....++- .....-..|....
T Consensus 286 IWDI~tG~lkrsF~~~-~~~~~~WP~frWS~DdK---------y~Arm~~-~sisIyEtpsf~lld-~Kslki~gIr~Fs 353 (698)
T KOG2314|consen 286 IWDIATGLLKRSFPVI-KSPYLKWPIFRWSHDDK---------YFARMTG-NSISIYETPSFMLLD-KKSLKISGIRDFS 353 (698)
T ss_pred EEEccccchhcceecc-CCCccccceEEeccCCc---------eeEEecc-ceEEEEecCceeeec-ccccCCccccCcc
Confidence 7999999999888742 11222334578999999 8887665 469999976643321 1111345789999
Q ss_pred EecCCCEEEEEeCC-----CcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE-ec--------Cc---EEEEECC
Q 036605 81 FAKKGRSLHVVGTN-----GMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL-AS--------SE---VRILSLE 143 (340)
Q Consensus 81 ~~~~~~~l~s~~~d-----g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~-~~--------~~---i~i~d~~ 143 (340)
|+|.++.|+.=... ..+.+..+.+++.++.-..+.-.-..+-|-.+|.+|.. .+ +. +-|+.++
T Consensus 354 wsP~~~llAYwtpe~~~~parvtL~evPs~~~iRt~nlfnVsDckLhWQk~gdyLcvkvdR~tK~~~~g~f~n~eIfrir 433 (698)
T KOG2314|consen 354 WSPTSNLLAYWTPETNNIPARVTLMEVPSKREIRTKNLFNVSDCKLHWQKSGDYLCVKVDRHTKSKVKGQFSNLEIFRIR 433 (698)
T ss_pred cCCCcceEEEEcccccCCcceEEEEecCccceeeeccceeeeccEEEeccCCcEEEEEEEeeccccccceEeeEEEEEee
Confidence 99998888764322 46778888888777665444433455677788888865 11 11 5566666
Q ss_pred CCceeEEeecCCCCeEEEEECCCCCEEEEEEcC--CCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEE
Q 036605 144 NGEEVLKFSDDVGPLQYVSASDGAKIIITAGYG--EKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVI 221 (340)
Q Consensus 144 ~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~--d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l 221 (340)
..............|...+|-|.|..+++-+.+ ..++.+|.+....+.......+ .. .....+ .| +|.|.++
T Consensus 434 eKdIpve~velke~vi~FaWEP~gdkF~vi~g~~~k~tvsfY~~e~~~~~~~lVk~~--dk-~~~N~v--fw-sPkG~fv 507 (698)
T KOG2314|consen 434 EKDIPVEVVELKESVIAFAWEPHGDKFAVISGNTVKNTVSFYAVETNIKKPSLVKEL--DK-KFANTV--FW-SPKGRFV 507 (698)
T ss_pred ccCCCceeeecchheeeeeeccCCCeEEEEEccccccceeEEEeecCCCchhhhhhh--cc-cccceE--EE-cCCCcEE
Confidence 554433333345678889999999877654443 4678899884222211111111 11 112223 45 8999998
Q ss_pred EEE---eCCCcEEEEECCC
Q 036605 222 LAV---AESGVAYSWDLKT 237 (340)
Q Consensus 222 ~~~---s~dg~i~vwd~~~ 237 (340)
+.+ |..|.+.++|...
T Consensus 508 vva~l~s~~g~l~F~D~~~ 526 (698)
T KOG2314|consen 508 VVAALVSRRGDLEFYDTDY 526 (698)
T ss_pred EEEEecccccceEEEecch
Confidence 776 4578899999885
No 294
>COG5170 CDC55 Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=98.65 E-value=7.6e-07 Score=71.95 Aligned_cols=205 Identities=13% Similarity=0.103 Sum_probs=130.6
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe-----eEEEecCCCC------------CCeEEEEEe
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE-----MKWKSTGRHP------------GGLAGLAFA 82 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~-----~~~~~~~~h~------------~~v~~v~~~ 82 (340)
....|+++.|...|. ||++|...|.|.+|.-+... ....+++ |. ..|..+.|.
T Consensus 25 ead~ItaVefd~tg~---------YlatGDkgGRVvlfer~~s~~ceykf~teFQs-he~EFDYLkSleieEKin~I~w~ 94 (460)
T COG5170 25 EADKITAVEFDETGL---------YLATGDKGGRVVLFEREKSYGCEYKFFTEFQS-HELEFDYLKSLEIEEKINAIEWF 94 (460)
T ss_pred ccceeeEEEeccccc---------eEeecCCCceEEEeecccccccchhhhhhhcc-cccchhhhhhccHHHHhhheeee
Confidence 346789999998888 99999999999999865433 1122333 43 367889987
Q ss_pred cCCC--EEEEEeCCCcEEEEeCCCCeE-------------------------------------E-----EE-eecCCCC
Q 036605 83 KKGR--SLHVVGTNGMASEMKSEMGEV-------------------------------------I-----RE-FKASEKP 117 (340)
Q Consensus 83 ~~~~--~l~s~~~dg~i~~wd~~~~~~-------------------------------------~-----~~-~~~~~~~ 117 (340)
.++. .++..+.|.+|++|.+..... + +. -..|...
T Consensus 95 ~~t~r~hFLlstNdktiKlWKiyeknlk~va~nnls~~~~~~~~g~~~s~~~l~lprls~hd~iiaa~p~rvyaNaH~yh 174 (460)
T COG5170 95 DDTGRNHFLLSTNDKTIKLWKIYEKNLKVVAENNLSDSFHSPMGGPLTSTKELLLPRLSEHDEIIAAKPCRVYANAHPYH 174 (460)
T ss_pred cCCCcceEEEecCCceeeeeeeecccchhhhccccccccccccCCCcCCHHHhhcccccccceEEEeccceeccccceeE
Confidence 6554 466668899999998653210 0 00 1245556
Q ss_pred eeEEEEccCCCEEEEecCc-EEEEECCCCce---eEEeecCC-----CCeEEEEECCCCCEEEEEEcCCCeEEEEEccCC
Q 036605 118 ISSSAFLCEEKIFALASSE-VRILSLENGEE---VLKFSDDV-----GPLQYVSASDGAKIIITAGYGEKHLQVWRCDIS 188 (340)
Q Consensus 118 i~~l~~~~~~~~l~~~~~~-i~i~d~~~~~~---~~~~~~~~-----~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~ 188 (340)
+.++.+..|...+++++.- |.+|++.-... +..++.|. ..|++..|+|....++.-+...|.|++-|+|..
T Consensus 175 iNSiS~NsD~et~lSaDdLrINLWnl~i~D~sFnIVDiKP~nmeeLteVItSaeFhp~~cn~fmYSsSkG~Ikl~DlRq~ 254 (460)
T COG5170 175 INSISFNSDKETLLSADDLRINLWNLEIIDGSFNIVDIKPHNMEELTEVITSAEFHPEMCNVFMYSSSKGEIKLNDLRQS 254 (460)
T ss_pred eeeeeecCchheeeeccceeeeeccccccCCceEEEeccCccHHHHHHHHhhcccCHhHcceEEEecCCCcEEehhhhhh
Confidence 7889999999888887765 99999864322 22334443 467888999975544444444899999999733
Q ss_pred CCCcc--CCceeeec---C------CCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCC
Q 036605 189 SKTVN--KGPALSMR---H------SPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTV 238 (340)
Q Consensus 189 ~~~~~--~~~~~~~~---~------~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~ 238 (340)
.--.. ..+...+. + ...+.++ -| +++|+++++-..- +|.+||+...
T Consensus 255 alcdn~~klfe~~~D~v~~~ff~eivsSISD~--kF-s~ngryIlsRdyl-tvkiwDvnm~ 311 (460)
T COG5170 255 ALCDNSKKLFELTIDGVDVDFFEEIVSSISDF--KF-SDNGRYILSRDYL-TVKIWDVNMA 311 (460)
T ss_pred hhccCchhhhhhccCcccchhHHHHhhhhcce--EE-cCCCcEEEEeccc-eEEEEecccc
Confidence 21000 00110000 0 0111222 33 7889988876654 5999999863
No 295
>COG5354 Uncharacterized protein, contains Trp-Asp (WD) repeat [General function prediction only]
Probab=98.64 E-value=6.4e-06 Score=70.95 Aligned_cols=170 Identities=11% Similarity=0.137 Sum_probs=113.6
Q ss_pred CccCCCCceeeeeeCCCCCCCCC--eE-EEEeeccccccccccCceEEEEEcCCCcEEEEEccCCee-EEEecCCCCCCe
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVS--YS-CLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEM-KWKSTGRHPGGL 76 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~--v~-~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~-~~~~~~~h~~~v 76 (340)
|||..+|.++..|... ..+ .. -+.|+-+.+ |+|-- ....++|+++ ++.. ...+...-...|
T Consensus 112 vwd~~sg~iv~sf~~~----~q~~~~Wp~~k~s~~D~---------y~ARv-v~~sl~i~e~-t~n~~~~p~~~lr~~gi 176 (561)
T COG5354 112 VWDIASGMIVFSFNGI----SQPYLGWPVLKFSIDDK---------YVARV-VGSSLYIHEI-TDNIEEHPFKNLRPVGI 176 (561)
T ss_pred EEeccCceeEeecccc----CCcccccceeeeeecch---------hhhhh-ccCeEEEEec-CCccccCchhhccccce
Confidence 6999999999888733 333 33 688998887 55544 4557999997 4332 222222123568
Q ss_pred EEEEEecCCC--EEEE-----EeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE-------------ecCc
Q 036605 77 AGLAFAKKGR--SLHV-----VGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL-------------ASSE 136 (340)
Q Consensus 77 ~~v~~~~~~~--~l~s-----~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~-------------~~~~ 136 (340)
....|+|.++ .|+. .+.++.+++|.+..+..+..-..-+..-..+.|.+.|.+|.+ |...
T Consensus 177 ~dFsisP~~n~~~la~~tPEk~~kpa~~~i~sIp~~s~l~tk~lfk~~~~qLkW~~~g~~ll~l~~t~~ksnKsyfgesn 256 (561)
T COG5354 177 LDFSISPEGNHDELAYWTPEKLNKPAMVRILSIPKNSVLVTKNLFKVSGVQLKWQVLGKYLLVLVMTHTKSNKSYFGESN 256 (561)
T ss_pred eeEEecCCCCCceEEEEccccCCCCcEEEEEEccCCCeeeeeeeEeecccEEEEecCCceEEEEEEEeeecccceeccce
Confidence 8899999643 3443 456789999999877766553333333457889999988754 1122
Q ss_pred EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEE-cCCCeEEEEEcc
Q 036605 137 VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAG-YGEKHLQVWRCD 186 (340)
Q Consensus 137 i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~-~~d~~i~iwd~~ 186 (340)
++++++... .+.......++|...+|.|.++.+++.+ ..+..+.++|++
T Consensus 257 Lyl~~~~e~-~i~V~~~~~~pVhdf~W~p~S~~F~vi~g~~pa~~s~~~lr 306 (561)
T COG5354 257 LYLLRITER-SIPVEKDLKDPVHDFTWEPLSSRFAVISGYMPASVSVFDLR 306 (561)
T ss_pred EEEEeeccc-ccceeccccccceeeeecccCCceeEEecccccceeecccc
Confidence 888888743 2322225578999999999887766654 558889999984
No 296
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=98.64 E-value=1.5e-05 Score=70.22 Aligned_cols=189 Identities=16% Similarity=0.175 Sum_probs=109.9
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEE
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAF 123 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~ 123 (340)
.+++++.+|.|..+|..+|+.++++.- .......+.. ++..++.++.++.+..+|..+|+.+..............+
T Consensus 67 ~v~v~~~~g~v~a~d~~tG~~~W~~~~-~~~~~~~p~v--~~~~v~v~~~~g~l~ald~~tG~~~W~~~~~~~~~~~p~v 143 (377)
T TIGR03300 67 KVYAADADGTVVALDAETGKRLWRVDL-DERLSGGVGA--DGGLVFVGTEKGEVIALDAEDGKELWRAKLSSEVLSPPLV 143 (377)
T ss_pred EEEEECCCCeEEEEEccCCcEeeeecC-CCCcccceEE--cCCEEEEEcCCCEEEEEECCCCcEeeeeccCceeecCCEE
Confidence 588888999999999999999988764 2221222322 4678888899999999999999988765533221112222
Q ss_pred ccCCCEEEE-ecCcEEEEECCCCceeEEeecCCCCe-----EEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCce
Q 036605 124 LCEEKIFAL-ASSEVRILSLENGEEVLKFSDDVGPL-----QYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPA 197 (340)
Q Consensus 124 ~~~~~~l~~-~~~~i~i~d~~~~~~~~~~~~~~~~v-----~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~ 197 (340)
.++..++. .++.++.||.++|+.+.++....... ....+. ++ .++.+.. ++.+..+|. .+++......
T Consensus 144 -~~~~v~v~~~~g~l~a~d~~tG~~~W~~~~~~~~~~~~~~~sp~~~-~~-~v~~~~~-~g~v~ald~--~tG~~~W~~~ 217 (377)
T TIGR03300 144 -ANGLVVVRTNDGRLTALDAATGERLWTYSRVTPALTLRGSASPVIA-DG-GVLVGFA-GGKLVALDL--QTGQPLWEQR 217 (377)
T ss_pred -ECCEEEEECCCCeEEEEEcCCCceeeEEccCCCceeecCCCCCEEE-CC-EEEEECC-CCEEEEEEc--cCCCEeeeec
Confidence 23433333 45569999999998776654322111 111222 23 5565455 788888887 4444322111
Q ss_pred eeecCCC----eeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 198 LSMRHSP----VAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 198 ~~~~~~~----~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
....... ....+.... .-.+..+++++.+|.++.||..+++.+-
T Consensus 218 ~~~~~g~~~~~~~~~~~~~p-~~~~~~vy~~~~~g~l~a~d~~tG~~~W 265 (377)
T TIGR03300 218 VALPKGRTELERLVDVDGDP-VVDGGQVYAVSYQGRVAALDLRSGRVLW 265 (377)
T ss_pred cccCCCCCchhhhhccCCcc-EEECCEEEEEEcCCEEEEEECCCCcEEE
Confidence 1000000 000000000 1134567777888888888888765543
No 297
>PF08450 SGL: SMP-30/Gluconolaconase/LRE-like region; InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=98.62 E-value=3.6e-05 Score=63.52 Aligned_cols=157 Identities=15% Similarity=0.117 Sum_probs=97.4
Q ss_pred eEEEEee-ccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEec---CC-CCCCeEEEEEecCCCEEEEEeCC----
Q 036605 24 YSCLACG-FVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKST---GR-HPGGLAGLAFAKKGRSLHVVGTN---- 94 (340)
Q Consensus 24 v~~l~~s-p~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~---~~-h~~~v~~v~~~~~~~~l~s~~~d---- 94 (340)
...+++. ++++ |+++... .+.++|..+++....+. .. .....+.+++.++|+..++....
T Consensus 42 ~~G~~~~~~~g~----------l~v~~~~-~~~~~d~~~g~~~~~~~~~~~~~~~~~~ND~~vd~~G~ly~t~~~~~~~~ 110 (246)
T PF08450_consen 42 PNGMAFDRPDGR----------LYVADSG-GIAVVDPDTGKVTVLADLPDGGVPFNRPNDVAVDPDGNLYVTDSGGGGAS 110 (246)
T ss_dssp EEEEEEECTTSE----------EEEEETT-CEEEEETTTTEEEEEEEEETTCSCTEEEEEEEE-TTS-EEEEEECCBCTT
T ss_pred CceEEEEccCCE----------EEEEEcC-ceEEEecCCCcEEEEeeccCCCcccCCCceEEEcCCCCEEEEecCCCccc
Confidence 5566666 6666 5555444 45666999886443332 21 33467899999999966665433
Q ss_pred ----CcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec---CcEEEEECCCCce-e---EEe---ecCCCCeEE
Q 036605 95 ----GMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALAS---SEVRILSLENGEE-V---LKF---SDDVGPLQY 160 (340)
Q Consensus 95 ----g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~---~~i~i~d~~~~~~-~---~~~---~~~~~~v~~ 160 (340)
|.|..++.. ++...... .-.....|+|+|+++.|+.++ +.|..|++..... + ..+ ....+....
T Consensus 111 ~~~~g~v~~~~~~-~~~~~~~~-~~~~pNGi~~s~dg~~lyv~ds~~~~i~~~~~~~~~~~~~~~~~~~~~~~~~g~pDG 188 (246)
T PF08450_consen 111 GIDPGSVYRIDPD-GKVTVVAD-GLGFPNGIAFSPDGKTLYVADSFNGRIWRFDLDADGGELSNRRVFIDFPGGPGYPDG 188 (246)
T ss_dssp CGGSEEEEEEETT-SEEEEEEE-EESSEEEEEEETTSSEEEEEETTTTEEEEEEEETTTCCEEEEEEEEE-SSSSCEEEE
T ss_pred cccccceEEECCC-CeEEEEec-CcccccceEECCcchheeecccccceeEEEeccccccceeeeeeEEEcCCCCcCCCc
Confidence 568888887 55443333 344568999999999887643 3388888853221 1 222 222234788
Q ss_pred EEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCce
Q 036605 161 VSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPA 197 (340)
Q Consensus 161 ~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~ 197 (340)
+++..+|+..++... .+.|.+++. .++....+.
T Consensus 189 ~~vD~~G~l~va~~~-~~~I~~~~p---~G~~~~~i~ 221 (246)
T PF08450_consen 189 LAVDSDGNLWVADWG-GGRIVVFDP---DGKLLREIE 221 (246)
T ss_dssp EEEBTTS-EEEEEET-TTEEEEEET---TSCEEEEEE
T ss_pred ceEcCCCCEEEEEcC-CCEEEEECC---CccEEEEEc
Confidence 999999976666444 899999995 355544444
No 298
>KOG1912 consensus WD40 repeat protein [General function prediction only]
Probab=98.60 E-value=2.9e-06 Score=76.67 Aligned_cols=150 Identities=12% Similarity=0.125 Sum_probs=115.5
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCC------------CEEEE
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKG------------RSLHV 90 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~------------~~l~s 90 (340)
.-.++.|+|.|- +|.|+.. .|.+.|..+-+.+..+.. |+..|+.+.|.|-. -.|++
T Consensus 17 N~~A~Dw~~~GL----------iAygshs-lV~VVDs~s~q~iqsie~-h~s~V~~VrWap~~~p~~llS~~~~~lliAs 84 (1062)
T KOG1912|consen 17 NRNAADWSPSGL----------IAYGSHS-LVSVVDSRSLQLIQSIEL-HQSAVTSVRWAPAPSPRDLLSPSSSQLLIAS 84 (1062)
T ss_pred cccccccCccce----------EEEecCc-eEEEEehhhhhhhhcccc-CccceeEEEeccCCCchhccCccccceeEEe
Confidence 356788998775 7887654 688899988888888888 99999999998731 13556
Q ss_pred EeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccC---C-CEEEE--ecCcEEEEECCCCceeEEeecCCCCeEEEEEC
Q 036605 91 VGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCE---E-KIFAL--ASSEVRILSLENGEEVLKFSDDVGPLQYVSAS 164 (340)
Q Consensus 91 ~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~---~-~~l~~--~~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s 164 (340)
+.-.|.|.+||...+..+..+..+..++..++|-+. . ..|+. +...+.+|+..+|+.+-++........++.+.
T Consensus 85 aD~~GrIil~d~~~~s~~~~l~~~~~~~qdl~W~~~rd~Srd~LlaIh~ss~lvLwntdtG~k~Wk~~ys~~iLs~f~~D 164 (1062)
T KOG1912|consen 85 ADISGRIILVDFVLASVINWLSHSNDSVQDLCWVPARDDSRDVLLAIHGSSTLVLWNTDTGEKFWKYDYSHEILSCFRVD 164 (1062)
T ss_pred ccccCcEEEEEehhhhhhhhhcCCCcchhheeeeeccCcchheeEEecCCcEEEEEEccCCceeeccccCCcceeeeeeC
Confidence 666799999999999988889989999999998763 3 23333 55569999999999887776666677778887
Q ss_pred CC-CCEEEEEEcCCCeEEEEEc
Q 036605 165 DG-AKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 165 ~~-~~~l~s~~~~d~~i~iwd~ 185 (340)
|- .+++...+. .|.+.+.+.
T Consensus 165 Pfd~rh~~~l~s-~g~vl~~~~ 185 (1062)
T KOG1912|consen 165 PFDSRHFCVLGS-KGFVLSCKD 185 (1062)
T ss_pred CCCcceEEEEcc-CceEEEEec
Confidence 73 455555555 677777765
No 299
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=98.59 E-value=1.2e-05 Score=65.95 Aligned_cols=181 Identities=15% Similarity=0.193 Sum_probs=108.0
Q ss_pred CCCcEEEEEccCCeeEEEecCCC-CCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCC
Q 036605 50 SNGDILAVDVLTGEMKWKSTGRH-PGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEK 128 (340)
Q Consensus 50 ~dg~i~i~d~~~~~~~~~~~~~h-~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~ 128 (340)
.+|+|..||..+|+.+++..-.. .....+. ..+++..+++++.++.+..||..+|+.+..+... ..+.......++.
T Consensus 1 ~~g~l~~~d~~tG~~~W~~~~~~~~~~~~~~-~~~~~~~v~~~~~~~~l~~~d~~tG~~~W~~~~~-~~~~~~~~~~~~~ 78 (238)
T PF13360_consen 1 DDGTLSALDPRTGKELWSYDLGPGIGGPVAT-AVPDGGRVYVASGDGNLYALDAKTGKVLWRFDLP-GPISGAPVVDGGR 78 (238)
T ss_dssp -TSEEEEEETTTTEEEEEEECSSSCSSEEET-EEEETTEEEEEETTSEEEEEETTTSEEEEEEECS-SCGGSGEEEETTE
T ss_pred CCCEEEEEECCCCCEEEEEECCCCCCCccce-EEEeCCEEEEEcCCCEEEEEECCCCCEEEEeecc-ccccceeeecccc
Confidence 36899999999999999886311 1122211 2335778888899999999999999998887763 3322222333444
Q ss_pred EEEE-ecCcEEEEECCCCceeEEe-ecCC---CCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCC
Q 036605 129 IFAL-ASSEVRILSLENGEEVLKF-SDDV---GPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHS 203 (340)
Q Consensus 129 ~l~~-~~~~i~i~d~~~~~~~~~~-~~~~---~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~ 203 (340)
.++. .++.++.+|..+|+.+..+ .... ..........++..++.+.. ++.|..+|. .+++............
T Consensus 79 v~v~~~~~~l~~~d~~tG~~~W~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~g~l~~~d~--~tG~~~w~~~~~~~~~ 155 (238)
T PF13360_consen 79 VYVGTSDGSLYALDAKTGKVLWSIYLTSSPPAGVRSSSSPAVDGDRLYVGTS-SGKLVALDP--KTGKLLWKYPVGEPRG 155 (238)
T ss_dssp EEEEETTSEEEEEETTTSCEEEEEEE-SSCTCSTB--SEEEEETTEEEEEET-CSEEEEEET--TTTEEEEEEESSTT-S
T ss_pred cccccceeeeEecccCCcceeeeeccccccccccccccCceEecCEEEEEec-cCcEEEEec--CCCcEEEEeecCCCCC
Confidence 4433 4567999999999988773 3221 11122222223667777676 899999997 4555433222111110
Q ss_pred C--------eeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCc
Q 036605 204 P--------VAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQ 240 (340)
Q Consensus 204 ~--------~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~ 240 (340)
. ..... .. .++ .++.++.+|.+.-+|+.+++.
T Consensus 156 ~~~~~~~~~~~~~~--~~--~~~-~v~~~~~~g~~~~~d~~tg~~ 195 (238)
T PF13360_consen 156 SSPISSFSDINGSP--VI--SDG-RVYVSSGDGRVVAVDLATGEK 195 (238)
T ss_dssp S--EEEETTEEEEE--EC--CTT-EEEEECCTSSEEEEETTTTEE
T ss_pred Ccceeeecccccce--EE--ECC-EEEEEcCCCeEEEEECCCCCE
Confidence 0 01111 11 234 777778888644448888763
No 300
>COG5170 CDC55 Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=98.58 E-value=7.2e-07 Score=72.10 Aligned_cols=203 Identities=14% Similarity=0.147 Sum_probs=127.5
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCee-------------------------------------
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEM------------------------------------- 64 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~------------------------------------- 64 (340)
..|..+.|..++. ...++..+.|.+|.+|.+.....
T Consensus 86 EKin~I~w~~~t~-------r~hFLlstNdktiKlWKiyeknlk~va~nnls~~~~~~~~g~~~s~~~l~lprls~hd~i 158 (460)
T COG5170 86 EKINAIEWFDDTG-------RNHFLLSTNDKTIKLWKIYEKNLKVVAENNLSDSFHSPMGGPLTSTKELLLPRLSEHDEI 158 (460)
T ss_pred HHhhheeeecCCC-------cceEEEecCCceeeeeeeecccchhhhccccccccccccCCCcCCHHHhhcccccccceE
Confidence 4567788865542 12577778999999998643310
Q ss_pred E-----EEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCe---EEEEeecCC-----CCeeEEEEccCCCEEE
Q 036605 65 K-----WKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGE---VIREFKASE-----KPISSSAFLCEEKIFA 131 (340)
Q Consensus 65 ~-----~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~---~~~~~~~~~-----~~i~~l~~~~~~~~l~ 131 (340)
+ +.+...|+-.|+++.|+.|...+++ +.|-.|.+|++.--. .+..++.|. .-|++..|+|....++
T Consensus 159 iaa~p~rvyaNaH~yhiNSiS~NsD~et~lS-aDdLrINLWnl~i~D~sFnIVDiKP~nmeeLteVItSaeFhp~~cn~f 237 (460)
T COG5170 159 IAAKPCRVYANAHPYHINSISFNSDKETLLS-ADDLRINLWNLEIIDGSFNIVDIKPHNMEELTEVITSAEFHPEMCNVF 237 (460)
T ss_pred EEeccceeccccceeEeeeeeecCchheeee-ccceeeeeccccccCCceEEEeccCccHHHHHHHHhhcccCHhHcceE
Confidence 0 0112347778899999988887776 567799999876432 122233333 2477888999765443
Q ss_pred --E-ecCcEEEEECCCCce------eEE----------eecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCc
Q 036605 132 --L-ASSEVRILSLENGEE------VLK----------FSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTV 192 (340)
Q Consensus 132 --~-~~~~i~i~d~~~~~~------~~~----------~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~ 192 (340)
+ ..+.|++-|++.... +.. |..-...|..+.|+++|+|+++-.. -++.|||+++... .
T Consensus 238 mYSsSkG~Ikl~DlRq~alcdn~~klfe~~~D~v~~~ff~eivsSISD~kFs~ngryIlsRdy--ltvkiwDvnm~k~-p 314 (460)
T COG5170 238 MYSSSKGEIKLNDLRQSALCDNSKKLFELTIDGVDVDFFEEIVSSISDFKFSDNGRYILSRDY--LTVKIWDVNMAKN-P 314 (460)
T ss_pred EEecCCCcEEehhhhhhhhccCchhhhhhccCcccchhHHHHhhhhcceEEcCCCcEEEEecc--ceEEEEecccccC-C
Confidence 2 556699999984321 111 1222367889999999999998444 7999999974432 2
Q ss_pred cCCcee----------eecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECC
Q 036605 193 NKGPAL----------SMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 193 ~~~~~~----------~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
+....+ ..+.....-.+.+.+ +.+...+++|+..+..-+|-..
T Consensus 315 ikTi~~h~~l~~~l~d~YEnDaifdkFeisf-Sgd~~~v~sgsy~NNfgiyp~~ 367 (460)
T COG5170 315 IKTIPMHCDLMDELNDVYENDAIFDKFEISF-SGDDKHVLSGSYSNNFGIYPTD 367 (460)
T ss_pred ceeechHHHHHHHHHhhhhccceeeeEEEEe-cCCcccccccccccceeeeccc
Confidence 222110 001122222333455 7888899999998888877643
No 301
>KOG4714 consensus Nucleoporin [Nuclear structure]
Probab=98.56 E-value=8.7e-07 Score=69.82 Aligned_cols=140 Identities=11% Similarity=0.082 Sum_probs=88.6
Q ss_pred EEEEEcCCCcEEEEEccCCe-eEEEecCCCCCCeEEEEEecCCCEEEEEeC-----CCcEEEEeCCCCeEEEEeecCCCC
Q 036605 44 LLALGTSNGDILAVDVLTGE-MKWKSTGRHPGGLAGLAFAKKGRSLHVVGT-----NGMASEMKSEMGEVIREFKASEKP 117 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~-~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~-----dg~i~~wd~~~~~~~~~~~~~~~~ 117 (340)
-++++..||.+.+++.+.-. ..+++...|.+ -.+.+....++.+.++.- -+..+.|+++..+.+..-+.....
T Consensus 103 ~V~~~~~dg~~~v~s~~~~~~~~~~i~~~~~~-~as~~~~~~~~~i~s~~~g~~n~~d~~~a~~~~p~~t~~~~~~~~~~ 181 (319)
T KOG4714|consen 103 RVCIGYADGSLAVFSTDKDLALMSRIPSIHSG-SASRKICRHGNSILSGGCGNWNAQDNFYANTLDPIKTLIPSKKALDA 181 (319)
T ss_pred ceEecCCCceEEEEechHHHhhhhhccccccc-ccccceeecccEEecCCcceEeeccceeeeccccccccccccccccc
Confidence 48999999999999976521 11122211221 122223334555544321 234566666544333222222345
Q ss_pred eeEEEEccCCCEEEEec---CcEEEEECCCCcee-EEeecCCCCeEEEEECCC-CCEEEEEEcCCCeEEEEEc
Q 036605 118 ISSSAFLCEEKIFALAS---SEVRILSLENGEEV-LKFSDDVGPLQYVSASDG-AKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 118 i~~l~~~~~~~~l~~~~---~~i~i~d~~~~~~~-~~~~~~~~~v~~~~~s~~-~~~l~s~~~~d~~i~iwd~ 185 (340)
|++++-+|..+.++.++ +.+-+||.+..... ..+..|..+++.+.|+|. +..|++++. ||.+.-||.
T Consensus 182 v~~l~~hp~qq~~v~cgt~dg~~~l~d~rn~~~p~S~l~ahk~~i~eV~FHpk~p~~Lft~se-dGslw~wda 253 (319)
T KOG4714|consen 182 VTALCSHPAQQHLVCCGTDDGIVGLWDARNVAMPVSLLKAHKAEIWEVHFHPKNPEHLFTCSE-DGSLWHWDA 253 (319)
T ss_pred chhhhCCcccccEEEEecCCCeEEEEEcccccchHHHHHHhhhhhhheeccCCCchheeEecC-CCcEEEEcC
Confidence 89999999887776533 33999999987554 345889999999999885 567888777 999999996
No 302
>KOG4532 consensus WD40-like repeat containing protein [General function prediction only]
Probab=98.55 E-value=2.4e-05 Score=62.26 Aligned_cols=142 Identities=11% Similarity=0.029 Sum_probs=98.1
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCe-EEEE--eecCCCCeeE
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGE-VIRE--FKASEKPISS 120 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~-~~~~--~~~~~~~i~~ 120 (340)
-+..++.|.++++.+++.+.....+.. ..-.+..++.++|++++++.+....|..|.+.... .+.. .......-.+
T Consensus 130 ~~~i~sndht~k~~~~~~~s~~~~~h~-~~~~~ns~~~snd~~~~~~Vgds~~Vf~y~id~~sey~~~~~~a~t~D~gF~ 208 (344)
T KOG4532|consen 130 PLNIASNDHTGKTMVVSGDSNKFAVHN-QNLTQNSLHYSNDPSWGSSVGDSRRVFRYAIDDESEYIENIYEAPTSDHGFY 208 (344)
T ss_pred ceeeccCCcceeEEEEecCcccceeec-cccceeeeEEcCCCceEEEecCCCcceEEEeCCccceeeeeEecccCCCcee
Confidence 366778888898888876643333322 11238899999999999999999999999887543 2222 2223334467
Q ss_pred EEEccCCCEEEEe--cCcEEEEECCCCceeEE-----eecCCCCeEEEEECCCCCE-EEEEEcCCCeEEEEEcc
Q 036605 121 SAFLCEEKIFALA--SSEVRILSLENGEEVLK-----FSDDVGPLQYVSASDGAKI-IITAGYGEKHLQVWRCD 186 (340)
Q Consensus 121 l~~~~~~~~l~~~--~~~i~i~d~~~~~~~~~-----~~~~~~~v~~~~~s~~~~~-l~s~~~~d~~i~iwd~~ 186 (340)
..|+.....+|++ ++.+.|||++....... -..|.+.++.+.|++-|.. |+.-+.+-+.+.+.|+|
T Consensus 209 ~S~s~~~~~FAv~~Qdg~~~I~DVR~~~tpm~~~sstrp~hnGa~R~c~Fsl~g~lDLLf~sEhfs~~hv~D~R 282 (344)
T KOG4532|consen 209 NSFSENDLQFAVVFQDGTCAIYDVRNMATPMAEISSTRPHHNGAFRVCRFSLYGLLDLLFISEHFSRVHVVDTR 282 (344)
T ss_pred eeeccCcceEEEEecCCcEEEEEecccccchhhhcccCCCCCCceEEEEecCCCcceEEEEecCcceEEEEEcc
Confidence 7888888777774 55599999987544322 2457899999999976542 33334556889999985
No 303
>KOG0309 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=98.54 E-value=6.4e-07 Score=80.33 Aligned_cols=158 Identities=9% Similarity=0.165 Sum_probs=114.0
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe---eEEEecCCCCCCeEEEEEecCC-CEEEEEeCCCcEE
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE---MKWKSTGRHPGGLAGLAFAKKG-RSLHVVGTNGMAS 98 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~---~~~~~~~~h~~~v~~v~~~~~~-~~l~s~~~dg~i~ 98 (340)
.|-...|+|... -++-++......-.+|++.... ....+.+ |...|+.+-|+|.. ..|++++.|..+.
T Consensus 69 ~vad~qws~h~a-------~~~wiVsts~qkaiiwnlA~ss~~aIef~lhg-hsraitd~n~~~q~pdVlatcsvdt~vh 140 (1081)
T KOG0309|consen 69 QVADVQWSPHPA-------KPYWIVSTSNQKAIIWNLAKSSSNAIEFVLHG-HSRAITDINFNPQHPDVLATCSVDTYVH 140 (1081)
T ss_pred hhcceecccCCC-------CceeEEecCcchhhhhhhhcCCccceEEEEec-CccceeccccCCCCCcceeeccccccce
Confidence 355677887652 1267777777778889876432 3334455 99999999999865 4789999999999
Q ss_pred EEeCCCCe-EEEEeecCCCCeeEEEEcc-CCCEEEEec-CcEEEEECCCCc-eeEEeecCCCCeEEEEECCCC-CEEEEE
Q 036605 99 EMKSEMGE-VIREFKASEKPISSSAFLC-EEKIFALAS-SEVRILSLENGE-EVLKFSDDVGPLQYVSASDGA-KIIITA 173 (340)
Q Consensus 99 ~wd~~~~~-~~~~~~~~~~~i~~l~~~~-~~~~l~~~~-~~i~i~d~~~~~-~~~~~~~~~~~v~~~~~s~~~-~~l~s~ 173 (340)
.||+++-. ++..+..-......+.|+. ++..+++.. ++|++||++.|. ++..+++|...|..+.|..-- ..+.++
T Consensus 141 ~wd~rSp~~p~ys~~~w~s~asqVkwnyk~p~vlasshg~~i~vwd~r~gs~pl~s~K~~vs~vn~~~fnr~~~s~~~s~ 220 (1081)
T KOG0309|consen 141 AWDMRSPHRPFYSTSSWRSAASQVKWNYKDPNVLASSHGNDIFVWDLRKGSTPLCSLKGHVSSVNSIDFNRFKYSEIMSS 220 (1081)
T ss_pred eeeccCCCcceeeeecccccCceeeecccCcchhhhccCCceEEEeccCCCcceEEecccceeeehHHHhhhhhhhhccc
Confidence 99998754 4445555556678888986 455666644 449999998764 557788899999999886532 245565
Q ss_pred EcCCCeEEEEEccCCC
Q 036605 174 GYGEKHLQVWRCDISS 189 (340)
Q Consensus 174 ~~~d~~i~iwd~~~~~ 189 (340)
+. |++|+.||....+
T Consensus 221 ~~-d~tvkfw~y~kSt 235 (1081)
T KOG0309|consen 221 SN-DGTVKFWDYSKST 235 (1081)
T ss_pred CC-CCceeeecccccc
Confidence 55 9999999985333
No 304
>PF11768 DUF3312: Protein of unknown function (DUF3312); InterPro: IPR024511 This is a eukaryotic family of uncharacterised proteins that contain WD40 repeats.
Probab=98.53 E-value=4.9e-07 Score=79.40 Aligned_cols=77 Identities=17% Similarity=0.128 Sum_probs=64.4
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
.+.+.|.|++++|+.. .|+.|+.||+|.+||...+... +.. ..-..+.++|+|+|..+++|+..|.+.
T Consensus 257 pL~s~v~~ca~sp~E~---------kLvlGC~DgSiiLyD~~~~~t~--~~k-a~~~P~~iaWHp~gai~~V~s~qGelQ 324 (545)
T PF11768_consen 257 PLPSQVICCARSPSED---------KLVLGCEDGSIILYDTTRGVTL--LAK-AEFIPTLIAWHPDGAIFVVGSEQGELQ 324 (545)
T ss_pred ecCCcceEEecCcccc---------eEEEEecCCeEEEEEcCCCeee--eee-ecccceEEEEcCCCcEEEEEcCCceEE
Confidence 4668899999999998 7999999999999998776432 223 455679999999999999999999999
Q ss_pred EEeCCCCeE
Q 036605 99 EMKSEMGEV 107 (340)
Q Consensus 99 ~wd~~~~~~ 107 (340)
+||+.-...
T Consensus 325 ~FD~ALspi 333 (545)
T PF11768_consen 325 CFDMALSPI 333 (545)
T ss_pred EEEeecCcc
Confidence 999865443
No 305
>KOG2066 consensus Vacuolar assembly/sorting protein VPS41 [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.53 E-value=3.9e-06 Score=76.10 Aligned_cols=185 Identities=15% Similarity=0.178 Sum_probs=119.1
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEe
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMK 101 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd 101 (340)
..++|++++ ++ +|+.|+-+|.|++++.... . .+... |... ..+|.++++|+.||.|.+-.
T Consensus 40 D~is~~av~--~~---------~~~~GtH~g~v~~~~~~~~-~-~~~~~-~s~~------~~~Gey~asCS~DGkv~I~s 99 (846)
T KOG2066|consen 40 DAISCCAVH--DK---------FFALGTHRGAVYLTTCQGN-P-KTNFD-HSSS------ILEGEYVASCSDDGKVVIGS 99 (846)
T ss_pred hHHHHHHhh--cc---------eeeeccccceEEEEecCCc-c-ccccc-cccc------ccCCceEEEecCCCcEEEee
Confidence 456677776 56 8999999999999996543 3 22222 5444 56799999999999999999
Q ss_pred CCCCeEEEEeecCCCCeeEEEEccC-----CCEEEEecCc-EEEEECC--CCceeEEeecCCCCeEEEEECCCCCEEEEE
Q 036605 102 SEMGEVIREFKASEKPISSSAFLCE-----EKIFALASSE-VRILSLE--NGEEVLKFSDDVGPLQYVSASDGAKIIITA 173 (340)
Q Consensus 102 ~~~~~~~~~~~~~~~~i~~l~~~~~-----~~~l~~~~~~-i~i~d~~--~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~ 173 (340)
+-+.+....+.. ..++.+++++|+ .+.+++||.. +.++.-. ..+....+....++|.++.|. |.+|+-
T Consensus 100 l~~~~~~~~~df-~rpiksial~Pd~~~~~sk~fv~GG~aglvL~er~wlgnk~~v~l~~~eG~I~~i~W~--g~lIAW- 175 (846)
T KOG2066|consen 100 LFTDDEITQYDF-KRPIKSIALHPDFSRQQSKQFVSGGMAGLVLSERNWLGNKDSVVLSEGEGPIHSIKWR--GNLIAW- 175 (846)
T ss_pred ccCCccceeEec-CCcceeEEeccchhhhhhhheeecCcceEEEehhhhhcCccceeeecCccceEEEEec--CcEEEE-
Confidence 988887776654 458899999998 4566776666 7666522 111112345567899999995 556666
Q ss_pred EcCCCeEEEEEccCCCCCccCCceeeecC-CCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECC
Q 036605 174 GYGEKHLQVWRCDISSKTVNKGPALSMRH-SPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 174 ~~~d~~i~iwd~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
+. |--|+|||. ..++.+..+..+... .+..+.....| . +...|+.| +..+|.|..++
T Consensus 176 an-d~Gv~vyd~--~~~~~l~~i~~p~~~~R~e~fpphl~W-~-~~~~LVIG-W~d~v~i~~I~ 233 (846)
T KOG2066|consen 176 AN-DDGVKVYDT--PTRQRLTNIPPPSQSVRPELFPPHLHW-Q-DEDRLVIG-WGDSVKICSIK 233 (846)
T ss_pred ec-CCCcEEEec--cccceeeccCCCCCCCCcccCCCceEe-c-CCCeEEEe-cCCeEEEEEEe
Confidence 55 677899998 444433322211111 11111121234 2 33445544 55569999887
No 306
>PRK02888 nitrous-oxide reductase; Validated
Probab=98.53 E-value=7.9e-06 Score=73.73 Aligned_cols=176 Identities=15% Similarity=0.156 Sum_probs=114.7
Q ss_pred cCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCC----CcEEEEeCCCCeEEEEeecCCCCeeEEEEc
Q 036605 49 TSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTN----GMASEMKSEMGEVIREFKASEKPISSSAFL 124 (340)
Q Consensus 49 ~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~d----g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~ 124 (340)
-..+.+.+.|.++.+..+.+.- .+....+.++++|+++++.+.+ ..+...+..+...+..+... .+ .++.
T Consensus 212 ey~~~vSvID~etmeV~~qV~V--dgnpd~v~~spdGk~afvTsyNsE~G~tl~em~a~e~d~~vvfni~--~i--ea~v 285 (635)
T PRK02888 212 KYRSLFTAVDAETMEVAWQVMV--DGNLDNVDTDYDGKYAFSTCYNSEEGVTLAEMMAAERDWVVVFNIA--RI--EEAV 285 (635)
T ss_pred ceeEEEEEEECccceEEEEEEe--CCCcccceECCCCCEEEEeccCcccCcceeeeccccCceEEEEchH--HH--HHhh
Confidence 3446777888888877776653 3355678899999999888643 23333333222222222111 01 1345
Q ss_pred cCCCEEEEecCcEEEEECCC----CceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCc-c------
Q 036605 125 CEEKIFALASSEVRILSLEN----GEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTV-N------ 193 (340)
Q Consensus 125 ~~~~~l~~~~~~i~i~d~~~----~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~-~------ 193 (340)
++|++....++.|.+.|..+ +..+..+..-......+.++|||+++++++..+.++.|+|+. +.+. .
T Consensus 286 kdGK~~~V~gn~V~VID~~t~~~~~~~v~~yIPVGKsPHGV~vSPDGkylyVanklS~tVSVIDv~--k~k~~~~~~~~~ 363 (635)
T PRK02888 286 KAGKFKTIGGSKVPVVDGRKAANAGSALTRYVPVPKNPHGVNTSPDGKYFIANGKLSPTVTVIDVR--KLDDLFDGKIKP 363 (635)
T ss_pred hCCCEEEECCCEEEEEECCccccCCcceEEEEECCCCccceEECCCCCEEEEeCCCCCcEEEEECh--hhhhhhhccCCc
Confidence 67888877777799999988 333333333445678999999999999988889999999994 3211 0
Q ss_pred ---CCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 194 ---KGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 194 ---~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
..-...++..|....+ .++|....+..-|..|..|++..
T Consensus 364 ~~~vvaevevGlGPLHTaF-----Dg~G~aytslf~dsqv~kwn~~~ 405 (635)
T PRK02888 364 RDAVVAEPELGLGPLHTAF-----DGRGNAYTTLFLDSQIVKWNIEA 405 (635)
T ss_pred cceEEEeeccCCCcceEEE-----CCCCCEEEeEeecceeEEEehHH
Confidence 0111122444444444 77888888999999999999876
No 307
>COG0823 TolB Periplasmic component of the Tol biopolymer transport system [Intracellular trafficking and secretion]
Probab=98.52 E-value=1.3e-05 Score=70.66 Aligned_cols=152 Identities=15% Similarity=0.070 Sum_probs=100.3
Q ss_pred CCCeEEEEeeccccccccccCceEEEEE---cCC-CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEe-CCC
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALG---TSN-GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVG-TNG 95 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g---~~d-g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~-~dg 95 (340)
...+..-+|+|+++ .++.- ... ..++++++.+++....+. ..+.-...+|+|||+.|+.+. .||
T Consensus 192 ~~~~~~p~ws~~~~---------~~~y~~f~~~~~~~i~~~~l~~g~~~~i~~--~~g~~~~P~fspDG~~l~f~~~rdg 260 (425)
T COG0823 192 GSLILTPAWSPDGK---------KLAYVSFELGGCPRIYYLDLNTGKRPVILN--FNGNNGAPAFSPDGSKLAFSSSRDG 260 (425)
T ss_pred CcceeccccCcCCC---------ceEEEEEecCCCceEEEEeccCCccceeec--cCCccCCccCCCCCCEEEEEECCCC
Confidence 45566678999986 23322 222 469999999987554444 344556779999999877654 454
Q ss_pred --cEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEec-Cc----EEEEECCCCceeEEeecCCCCeEEEEECCCCC
Q 036605 96 --MASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALAS-SE----VRILSLENGEEVLKFSDDVGPLQYVSASDGAK 168 (340)
Q Consensus 96 --~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~-~~----i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~ 168 (340)
.|.++|+.++. +..+....+.-..-.|+|||+.++..+ +. |.++++..+.. ..+......-....++|||+
T Consensus 261 ~~~iy~~dl~~~~-~~~Lt~~~gi~~~Ps~spdG~~ivf~Sdr~G~p~I~~~~~~g~~~-~riT~~~~~~~~p~~SpdG~ 338 (425)
T COG0823 261 SPDIYLMDLDGKN-LPRLTNGFGINTSPSWSPDGSKIVFTSDRGGRPQIYLYDLEGSQV-TRLTFSGGGNSNPVWSPDGD 338 (425)
T ss_pred CccEEEEcCCCCc-ceecccCCccccCccCCCCCCEEEEEeCCCCCcceEEECCCCCce-eEeeccCCCCcCccCCCCCC
Confidence 46777887766 334554444444677999999986633 22 99999887754 44443333334788999999
Q ss_pred EEEEEEcCCCe--EEEEEc
Q 036605 169 IIITAGYGEKH--LQVWRC 185 (340)
Q Consensus 169 ~l~s~~~~d~~--i~iwd~ 185 (340)
+|+..+..+|. |.+.|+
T Consensus 339 ~i~~~~~~~g~~~i~~~~~ 357 (425)
T COG0823 339 KIVFESSSGGQWDIDKNDL 357 (425)
T ss_pred EEEEEeccCCceeeEEecc
Confidence 99988754455 444444
No 308
>KOG1275 consensus PAB-dependent poly(A) ribonuclease, subunit PAN2 [Replication, recombination and repair]
Probab=98.51 E-value=2.6e-06 Score=78.23 Aligned_cols=137 Identities=15% Similarity=0.185 Sum_probs=102.2
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCC---------CcEEEEeCCCCeEEEEeecC
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTN---------GMASEMKSEMGEVIREFKAS 114 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~d---------g~i~~wd~~~~~~~~~~~~~ 114 (340)
++.+|...|+|.+-|..+.+.++++.. |++.|.++.. .|+.|++||.. ..|+|||++.-+.+.-+..+
T Consensus 189 ~lf~G~t~G~V~LrD~~s~~~iht~~a-Hs~siSDfDv--~GNlLitCG~S~R~~~l~~D~FvkVYDLRmmral~PI~~~ 265 (1118)
T KOG1275|consen 189 NLFCGDTRGTVFLRDPNSFETIHTFDA-HSGSISDFDV--QGNLLITCGYSMRRYNLAMDPFVKVYDLRMMRALSPIQFP 265 (1118)
T ss_pred EEEeecccceEEeecCCcCceeeeeec-cccceeeeec--cCCeEEEeecccccccccccchhhhhhhhhhhccCCcccc
Confidence 899999999999999999999999998 9999988766 49999999864 46899999887766555444
Q ss_pred CCCeeEEEEccCCC-EE--EEecCcEEEEE---CCCCc-eeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 115 EKPISSSAFLCEEK-IF--ALASSEVRILS---LENGE-EVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 115 ~~~i~~l~~~~~~~-~l--~~~~~~i~i~d---~~~~~-~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
.++ .-+.|+|.-. .+ ++.++...+-| +.+.. .+..+......+..+.+++++..++.+.. +|.|.+|.-
T Consensus 266 ~~P-~flrf~Psl~t~~~V~S~sGq~q~vd~~~lsNP~~~~~~v~p~~s~i~~fDiSsn~~alafgd~-~g~v~~wa~ 341 (1118)
T KOG1275|consen 266 YGP-QFLRFHPSLTTRLAVTSQSGQFQFVDTATLSNPPAGVKMVNPNGSGISAFDISSNGDALAFGDH-EGHVNLWAD 341 (1118)
T ss_pred cCc-hhhhhcccccceEEEEecccceeeccccccCCCccceeEEccCCCcceeEEecCCCceEEEecc-cCcEeeecC
Confidence 433 5566777532 22 33566677777 43331 12233333455899999999999999666 999999983
No 309
>KOG1920 consensus IkappaB kinase complex, IKAP component [Transcription]
Probab=98.49 E-value=3.6e-05 Score=73.19 Aligned_cols=198 Identities=14% Similarity=0.160 Sum_probs=128.6
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEE
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEM 100 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~w 100 (340)
+..|.++.|..++. -++.+...|.|.+-|.++.... +-+.-...|.+++|+||+..++..+..+++.+.
T Consensus 68 d~~i~s~~fl~d~~---------~i~v~~~~G~iilvd~et~~~e--ivg~vd~GI~aaswS~Dee~l~liT~~~tll~m 136 (1265)
T KOG1920|consen 68 DDEIVSVQFLADTN---------SICVITALGDIILVDPETLELE--IVGNVDNGISAASWSPDEELLALITGRQTLLFM 136 (1265)
T ss_pred CcceEEEEEecccc---------eEEEEecCCcEEEEccccccee--eeeeccCceEEEeecCCCcEEEEEeCCcEEEEE
Confidence 46899999998887 6999999999999998877532 222255689999999999999988887777665
Q ss_pred eCC----C-------------------CeEEEEeecC---------------------CCCeeEEEEccCCCEEEE----
Q 036605 101 KSE----M-------------------GEVIREFKAS---------------------EKPISSSAFLCEEKIFAL---- 132 (340)
Q Consensus 101 d~~----~-------------------~~~~~~~~~~---------------------~~~i~~l~~~~~~~~l~~---- 132 (340)
+-. . |+....|.+. ...-.+|.|--||.++++
T Consensus 137 T~~f~~i~E~~L~~d~~~~sk~v~VGwGrkeTqfrgs~gr~~~~~~~~~ek~~~~~~~~~~~~~IsWRgDg~~fAVs~~~ 216 (1265)
T KOG1920|consen 137 TKDFEPIAEKPLDADDERKSKFVNVGWGRKETQFRGSEGRQAARQKIEKEKALEQIEQDDHKTSISWRGDGEYFAVSFVE 216 (1265)
T ss_pred eccccchhccccccccccccccceecccccceeeecchhhhcccccccccccccchhhccCCceEEEccCCcEEEEEEEe
Confidence 421 0 1111112211 011235889999999987
Q ss_pred -e-c-CcEEEEECCCCceeEEe-ecCCCCeEEEEECCCCCEEEEEEcC--CCeEEEEEccCCCCCccCCceeeecCCCe-
Q 036605 133 -A-S-SEVRILSLENGEEVLKF-SDDVGPLQYVSASDGAKIIITAGYG--EKHLQVWRCDISSKTVNKGPALSMRHSPV- 205 (340)
Q Consensus 133 -~-~-~~i~i~d~~~~~~~~~~-~~~~~~v~~~~~s~~~~~l~s~~~~--d~~i~iwd~~~~~~~~~~~~~~~~~~~~~- 205 (340)
. + +.|++||-+ |. +... ....+.-.+++|-|.|..+++.... |+.|.+|.- .|.....+.+...-...
T Consensus 217 ~~~~~RkirV~drE-g~-Lns~se~~~~l~~~LsWkPsgs~iA~iq~~~sd~~IvffEr---NGL~hg~f~l~~p~de~~ 291 (1265)
T KOG1920|consen 217 SETGTRKIRVYDRE-GA-LNSTSEPVEGLQHSLSWKPSGSLIAAIQCKTSDSDIVFFER---NGLRHGEFVLPFPLDEKE 291 (1265)
T ss_pred ccCCceeEEEeccc-ch-hhcccCcccccccceeecCCCCeEeeeeecCCCCcEEEEec---CCccccccccCCcccccc
Confidence 2 2 459999976 42 2222 2223445679999999888875442 667889884 44444444433222222
Q ss_pred eeeeecCCCCCCCCEEEE---EeCCCcEEEEECCC
Q 036605 206 AIDCKNSPNGEDGTVILA---VAESGVAYSWDLKT 237 (340)
Q Consensus 206 ~~~~~~~~~~~~~~~l~~---~s~dg~i~vwd~~~ 237 (340)
+..+ .| ..++..|+. ......|++|-+.+
T Consensus 292 ve~L--~W-ns~sdiLAv~~~~~e~~~v~lwt~~N 323 (1265)
T KOG1920|consen 292 VEEL--AW-NSNSDILAVVTSNLENSLVQLWTTGN 323 (1265)
T ss_pred hhee--ee-cCCCCceeeeecccccceEEEEEecC
Confidence 4444 66 667777776 34444599998776
No 310
>KOG0309 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=98.47 E-value=1.9e-06 Score=77.46 Aligned_cols=208 Identities=9% Similarity=0.028 Sum_probs=133.4
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe-eEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE-MKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMA 97 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~-~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i 97 (340)
+|+..|+.+.|.|... +.+++++.|-.+..||+.... .+..+.. -...-..|+|+-....+.+.+....|
T Consensus 112 ghsraitd~n~~~q~p--------dVlatcsvdt~vh~wd~rSp~~p~ys~~~-w~s~asqVkwnyk~p~vlasshg~~i 182 (1081)
T KOG0309|consen 112 GHSRAITDINFNPQHP--------DVLATCSVDTYVHAWDMRSPHRPFYSTSS-WRSAASQVKWNYKDPNVLASSHGNDI 182 (1081)
T ss_pred cCccceeccccCCCCC--------cceeeccccccceeeeccCCCcceeeeec-ccccCceeeecccCcchhhhccCCce
Confidence 7999999999998873 289999999999999998765 3334433 33466789998754444445777789
Q ss_pred EEEeCCCCe-EEEEeecCCCCeeEEEEccCC-CEEEE--ecCcEEEEECCCCceeE-EeecCCCCeEEEEECCCCCEEE-
Q 036605 98 SEMKSEMGE-VIREFKASEKPISSSAFLCEE-KIFAL--ASSEVRILSLENGEEVL-KFSDDVGPLQYVSASDGAKIII- 171 (340)
Q Consensus 98 ~~wd~~~~~-~~~~~~~~~~~i~~l~~~~~~-~~l~~--~~~~i~i~d~~~~~~~~-~~~~~~~~v~~~~~s~~~~~l~- 171 (340)
.+||.+.|. ++..+++|...+..++|..-- ..+.+ .+++|+.||........ .......+|..-.|.|-|.-.+
T Consensus 183 ~vwd~r~gs~pl~s~K~~vs~vn~~~fnr~~~s~~~s~~~d~tvkfw~y~kSt~e~~~~vtt~~piw~~r~~Pfg~g~~~ 262 (1081)
T KOG0309|consen 183 FVWDLRKGSTPLCSLKGHVSSVNSIDFNRFKYSEIMSSSNDGTVKFWDYSKSTTESKRTVTTNFPIWRGRYLPFGEGYCI 262 (1081)
T ss_pred EEEeccCCCcceEEecccceeeehHHHhhhhhhhhcccCCCCceeeecccccccccceeccccCcceeccccccCceeEe
Confidence 999998764 677788888888888876532 12223 56669999987653332 2223346777777777544222
Q ss_pred EEEcCCCeEEEEEccCCCCC-----ccCCceeeecCCCeeeeeecCCC---------CCCCCEEEEEeCCCcEEEEECCC
Q 036605 172 TAGYGEKHLQVWRCDISSKT-----VNKGPALSMRHSPVAIDCKNSPN---------GEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 172 s~~~~d~~i~iwd~~~~~~~-----~~~~~~~~~~~~~~~~~~~~~~~---------~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
.-..++..+.+++.+....+ ....+..-.+|...+..+ .|. ......|++=+.|..+++|-+.+
T Consensus 263 mp~~G~n~v~~~~c~n~d~e~n~~~~~~pVh~F~GH~D~V~eF--lWR~r~e~~~d~d~rdfQLVTWSkD~~lrlWpI~~ 340 (1081)
T KOG0309|consen 263 MPMVGGNMVPQLRCENSDLEWNVFDLNTPVHTFVGHDDVVLEF--LWRKRKECDGDYDSRDFQLVTWSKDQTLRLWPIDS 340 (1081)
T ss_pred ccccCCeeeeeccccchhhhhccccCCcceeeecCcchHHHHH--hhhhcccccCCCCccceeEEEeecCCceEeeeccH
Confidence 22232445555554311111 122222223677666655 331 12234689999999999997765
No 311
>COG5354 Uncharacterized protein, contains Trp-Asp (WD) repeat [General function prediction only]
Probab=98.46 E-value=5.8e-06 Score=71.22 Aligned_cols=153 Identities=12% Similarity=0.054 Sum_probs=108.1
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCC----
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNG---- 95 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg---- 95 (340)
..-++..++|||.|+ +|++....| |.+|.......+.++. |. .|..+.|+|.+++|.+-+..+
T Consensus 31 ~~~p~~~~~~SP~G~---------~l~~~~~~~-V~~~~g~~~~~l~~~~--~~-~V~~~~fSP~~kYL~tw~~~pi~~p 97 (561)
T COG5354 31 ENWPVAYVSESPLGT---------YLFSEHAAG-VECWGGPSKAKLVRFR--HP-DVKYLDFSPNEKYLVTWSREPIIEP 97 (561)
T ss_pred cCcchhheeecCcch---------heehhhccc-eEEccccchhheeeee--cC-CceecccCcccceeeeeccCCccCh
Confidence 345788899999999 788776554 8999887776555555 44 799999999999999854433
Q ss_pred -----------cEEEEeCCCCeEEEEeecCCCC--ee-EEEEccCCCEEEE-ecCcEEEEECCCCce-eEEeec-CCCCe
Q 036605 96 -----------MASEMKSEMGEVIREFKASEKP--IS-SSAFLCEEKIFAL-ASSEVRILSLENGEE-VLKFSD-DVGPL 158 (340)
Q Consensus 96 -----------~i~~wd~~~~~~~~~~~~~~~~--i~-~l~~~~~~~~l~~-~~~~i~i~d~~~~~~-~~~~~~-~~~~v 158 (340)
.+.+||+.+|..+..+..-..+ .. -+.|+-+.++++- .+.+++++++ ++.. ...+.. ....+
T Consensus 98 e~e~sp~~~~n~~~vwd~~sg~iv~sf~~~~q~~~~Wp~~k~s~~D~y~ARvv~~sl~i~e~-t~n~~~~p~~~lr~~gi 176 (561)
T COG5354 98 EIEISPFTSKNNVFVWDIASGMIVFSFNGISQPYLGWPVLKFSIDDKYVARVVGSSLYIHEI-TDNIEEHPFKNLRPVGI 176 (561)
T ss_pred hhccCCccccCceeEEeccCceeEeeccccCCcccccceeeeeecchhhhhhccCeEEEEec-CCccccCchhhccccce
Confidence 4999999999999888766555 44 6788888888765 5556999997 3321 111211 13567
Q ss_pred EEEEECCCCCE--EEEE----EcCCCeEEEEEcc
Q 036605 159 QYVSASDGAKI--IITA----GYGEKHLQVWRCD 186 (340)
Q Consensus 159 ~~~~~s~~~~~--l~s~----~~~d~~i~iwd~~ 186 (340)
....|+|.+.. |+.- ...++.++||.+.
T Consensus 177 ~dFsisP~~n~~~la~~tPEk~~kpa~~~i~sIp 210 (561)
T COG5354 177 LDFSISPEGNHDELAYWTPEKLNKPAMVRILSIP 210 (561)
T ss_pred eeEEecCCCCCceEEEEccccCCCCcEEEEEEcc
Confidence 78888887432 2221 1127889999984
No 312
>COG0823 TolB Periplasmic component of the Tol biopolymer transport system [Intracellular trafficking and secretion]
Probab=98.40 E-value=2.4e-05 Score=69.14 Aligned_cols=175 Identities=17% Similarity=0.135 Sum_probs=111.0
Q ss_pred cEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEe---CC-CcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCC
Q 036605 53 DILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVG---TN-GMASEMKSEMGEVIREFKASEKPISSSAFLCEEK 128 (340)
Q Consensus 53 ~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~---~d-g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~ 128 (340)
.+.+-|.. |.....+.. -...+..-+|+|++..++... .. ..+.++++.+++...... ....-...+|+|||+
T Consensus 174 ~l~~~D~d-g~~~~~l~~-~~~~~~~p~ws~~~~~~~y~~f~~~~~~~i~~~~l~~g~~~~i~~-~~g~~~~P~fspDG~ 250 (425)
T COG0823 174 ELALGDYD-GYNQQKLTD-SGSLILTPAWSPDGKKLAYVSFELGGCPRIYYLDLNTGKRPVILN-FNGNNGAPAFSPDGS 250 (425)
T ss_pred eEEEEccC-CcceeEecc-cCcceeccccCcCCCceEEEEEecCCCceEEEEeccCCccceeec-cCCccCCccCCCCCC
Confidence 44444433 444444544 445678889999998765543 22 469999999887655544 223335577999999
Q ss_pred EEEEe-cC----cEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCC
Q 036605 129 IFALA-SS----EVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHS 203 (340)
Q Consensus 129 ~l~~~-~~----~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~ 203 (340)
.|+.. .+ +|+++|+.++. +..+....+.-..-.|+|||++++..++..|.-.||-.+.+.+.. ..+.......
T Consensus 251 ~l~f~~~rdg~~~iy~~dl~~~~-~~~Lt~~~gi~~~Ps~spdG~~ivf~Sdr~G~p~I~~~~~~g~~~-~riT~~~~~~ 328 (425)
T COG0823 251 KLAFSSSRDGSPDIYLMDLDGKN-LPRLTNGFGINTSPSWSPDGSKIVFTSDRGGRPQIYLYDLEGSQV-TRLTFSGGGN 328 (425)
T ss_pred EEEEEECCCCCccEEEEcCCCCc-ceecccCCccccCccCCCCCCEEEEEeCCCCCcceEEECCCCCce-eEeeccCCCC
Confidence 88662 22 29999998886 444544444455789999999999988888887777775444332 2233221211
Q ss_pred CeeeeeecCCCCCCCCEEEEEeCC-Cc--EEEEECCCC
Q 036605 204 PVAIDCKNSPNGEDGTVILAVAES-GV--AYSWDLKTV 238 (340)
Q Consensus 204 ~~~~~~~~~~~~~~~~~l~~~s~d-g~--i~vwd~~~~ 238 (340)
. ...+ +|||.+++..+.. |. |.+.++.++
T Consensus 329 --~---~p~~-SpdG~~i~~~~~~~g~~~i~~~~~~~~ 360 (425)
T COG0823 329 --S---NPVW-SPDGDKIVFESSSGGQWDIDKNDLASG 360 (425)
T ss_pred --c---CccC-CCCCCEEEEEeccCCceeeEEeccCCC
Confidence 1 2244 8999999887753 44 555555443
No 313
>KOG2041 consensus WD40 repeat protein [General function prediction only]
Probab=98.39 E-value=4.1e-06 Score=75.16 Aligned_cols=152 Identities=13% Similarity=0.147 Sum_probs=112.6
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe---------------eEEEecCCCCCCeEEEEEecCC
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE---------------MKWKSTGRHPGGLAGLAFAKKG 85 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~---------------~~~~~~~~h~~~v~~v~~~~~~ 85 (340)
.....|++|..... ++|.|+.||.+++..+.+.. .-+++.+ |.+.|..+.|+...
T Consensus 14 nvkL~c~~WNke~g---------yIAcgG~dGlLKVlKl~t~t~d~~~~glaa~snLsmNQtLeG-H~~sV~vvTWNe~~ 83 (1189)
T KOG2041|consen 14 NVKLHCAEWNKESG---------YIACGGADGLLKVLKLGTDTTDLNKSGLAAASNLSMNQTLEG-HNASVMVVTWNENN 83 (1189)
T ss_pred CceEEEEEEcccCC---------eEEeccccceeEEEEccccCCcccccccccccccchhhhhcc-CcceEEEEEecccc
Confidence 35678999998888 99999999999998765432 1234566 99999999999988
Q ss_pred CEEEEEeCCCcEEEEeCCCCeEEEEe--ecCCCCeeEEEEccCCCEEEE--ecCcEEEEECCCCcee-EEeecCCCCeEE
Q 036605 86 RSLHVVGTNGMASEMKSEMGEVIREF--KASEKPISSSAFLCEEKIFAL--ASSEVRILSLENGEEV-LKFSDDVGPLQY 160 (340)
Q Consensus 86 ~~l~s~~~dg~i~~wd~~~~~~~~~~--~~~~~~i~~l~~~~~~~~l~~--~~~~i~i~d~~~~~~~-~~~~~~~~~v~~ 160 (340)
+.|-+...+|.|.+|-+-.|.-...+ ...++.|.+++|+.+|..+.. .++.|.+=.+...+.- ..+.+ .....
T Consensus 84 QKLTtSDt~GlIiVWmlykgsW~EEMiNnRnKSvV~SmsWn~dG~kIcIvYeDGavIVGsvdGNRIwgKeLkg--~~l~h 161 (1189)
T KOG2041|consen 84 QKLTTSDTSGLIIVWMLYKGSWCEEMINNRNKSVVVSMSWNLDGTKICIVYEDGAVIVGSVDGNRIWGKELKG--QLLAH 161 (1189)
T ss_pred ccccccCCCceEEEEeeecccHHHHHhhCcCccEEEEEEEcCCCcEEEEEEccCCEEEEeeccceecchhcch--heccc
Confidence 99999999999999988776533332 234567889999999988754 6666655555443221 12222 23457
Q ss_pred EEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 161 VSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 161 ~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
+.|++|.+.++.+-. .|.+.+||-
T Consensus 162 v~ws~D~~~~Lf~~a-nge~hlydn 185 (1189)
T KOG2041|consen 162 VLWSEDLEQALFKKA-NGETHLYDN 185 (1189)
T ss_pred eeecccHHHHHhhhc-CCcEEEecc
Confidence 899999988888655 899999996
No 314
>KOG2066 consensus Vacuolar assembly/sorting protein VPS41 [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.39 E-value=2.2e-05 Score=71.44 Aligned_cols=135 Identities=11% Similarity=0.193 Sum_probs=98.7
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecC-----CCEEEEEeCCCcEEEEeCCC--CeEEEEeecCCC
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKK-----GRSLHVVGTNGMASEMKSEM--GEVIREFKASEK 116 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~-----~~~l~s~~~dg~i~~wd~~~--~~~~~~~~~~~~ 116 (340)
++++|+.||+|.|..+.+.+....+. ...++.+++++|+ .+.+++||.-| +.++.-.= .+.-..+....+
T Consensus 85 y~asCS~DGkv~I~sl~~~~~~~~~d--f~rpiksial~Pd~~~~~sk~fv~GG~ag-lvL~er~wlgnk~~v~l~~~eG 161 (846)
T KOG2066|consen 85 YVASCSDDGKVVIGSLFTDDEITQYD--FKRPIKSIALHPDFSRQQSKQFVSGGMAG-LVLSERNWLGNKDSVVLSEGEG 161 (846)
T ss_pred eEEEecCCCcEEEeeccCCccceeEe--cCCcceeEEeccchhhhhhhheeecCcce-EEEehhhhhcCccceeeecCcc
Confidence 99999999999999999888777666 4558999999997 45789999888 76664221 111113556678
Q ss_pred CeeEEEEccCCCEEEEecCc-EEEEECCCCceeEEeecCCCC------eEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 117 PISSSAFLCEEKIFALASSE-VRILSLENGEEVLKFSDDVGP------LQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 117 ~i~~l~~~~~~~~l~~~~~~-i~i~d~~~~~~~~~~~~~~~~------v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
+|.++.|. |.++|-++.. |++||+.+++.+..+...... ...+.|.++.+ |+. |. ..+|+|..++
T Consensus 162 ~I~~i~W~--g~lIAWand~Gv~vyd~~~~~~l~~i~~p~~~~R~e~fpphl~W~~~~~-LVI-GW-~d~v~i~~I~ 233 (846)
T KOG2066|consen 162 PIHSIKWR--GNLIAWANDDGVKVYDTPTRQRLTNIPPPSQSVRPELFPPHLHWQDEDR-LVI-GW-GDSVKICSIK 233 (846)
T ss_pred ceEEEEec--CcEEEEecCCCcEEEeccccceeeccCCCCCCCCcccCCCceEecCCCe-EEE-ec-CCeEEEEEEe
Confidence 99999997 6788887777 999999998877665432222 34577777664 444 45 5689999885
No 315
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=98.37 E-value=0.00015 Score=64.39 Aligned_cols=183 Identities=18% Similarity=0.160 Sum_probs=106.3
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCC----CeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCC---
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPG----GLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEK--- 116 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~----~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~--- 116 (340)
.+++++.+|.|..+|.++|+.++++...... ....... .+..++.++.+|.+..+|..+|+.+........
T Consensus 162 ~v~v~~~~g~l~ald~~tG~~~W~~~~~~~~~~~~~~~sP~v--~~~~v~~~~~~g~v~a~d~~~G~~~W~~~~~~~~~~ 239 (394)
T PRK11138 162 LVLVHTSNGMLQALNESDGAVKWTVNLDVPSLTLRGESAPAT--AFGGAIVGGDNGRVSAVLMEQGQLIWQQRISQPTGA 239 (394)
T ss_pred EEEEECCCCEEEEEEccCCCEeeeecCCCCcccccCCCCCEE--ECCEEEEEcCCCEEEEEEccCChhhheeccccCCCc
Confidence 4777888999999999999999988641110 0011111 134577788899999999999987665432110
Q ss_pred -C---eeEEEEcc---CCCEEEE-ecCcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCC
Q 036605 117 -P---ISSSAFLC---EEKIFAL-ASSEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDIS 188 (340)
Q Consensus 117 -~---i~~l~~~~---~~~~l~~-~~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~ 188 (340)
. ...+..+| ++..++. .++.+..+|..+|+.+-+... .....+.. .+..++.++. ++.+..+|. .
T Consensus 240 ~~~~~~~~~~~sP~v~~~~vy~~~~~g~l~ald~~tG~~~W~~~~--~~~~~~~~--~~~~vy~~~~-~g~l~ald~--~ 312 (394)
T PRK11138 240 TEIDRLVDVDTTPVVVGGVVYALAYNGNLVALDLRSGQIVWKREY--GSVNDFAV--DGGRIYLVDQ-NDRVYALDT--R 312 (394)
T ss_pred cchhcccccCCCcEEECCEEEEEEcCCeEEEEECCCCCEEEeecC--CCccCcEE--ECCEEEEEcC-CCeEEEEEC--C
Confidence 0 00111122 3333333 355699999999987644321 11112222 3446666566 899988887 4
Q ss_pred CCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 189 SKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 189 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
+++..-.... .... ... .. .-.+.+|+.++.+|.|+++|..+++.+.
T Consensus 313 tG~~~W~~~~-~~~~--~~~---sp-~v~~g~l~v~~~~G~l~~ld~~tG~~~~ 359 (394)
T PRK11138 313 GGVELWSQSD-LLHR--LLT---AP-VLYNGYLVVGDSEGYLHWINREDGRFVA 359 (394)
T ss_pred CCcEEEcccc-cCCC--ccc---CC-EEECCEEEEEeCCCEEEEEECCCCCEEE
Confidence 5443211110 0010 000 00 1124578889999999999998887654
No 316
>KOG1645 consensus RING-finger-containing E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=98.36 E-value=1.6e-05 Score=66.66 Aligned_cols=147 Identities=13% Similarity=0.042 Sum_probs=97.7
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCC-EEEEEeCCCcE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGR-SLHVVGTNGMA 97 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~-~l~s~~~dg~i 97 (340)
.+...|..|+|||..+ .++..++-+..|.|.|+++...+..+.. | ..+++++|..+.. ++|.|...|.|
T Consensus 191 ~~g~~IrdlafSp~~~--------GLl~~asl~nkiki~dlet~~~vssy~a-~-~~~wSC~wDlde~h~IYaGl~nG~V 260 (463)
T KOG1645|consen 191 GEGSFIRDLAFSPFNE--------GLLGLASLGNKIKIMDLETSCVVSSYIA-Y-NQIWSCCWDLDERHVIYAGLQNGMV 260 (463)
T ss_pred ccchhhhhhccCcccc--------ceeeeeccCceEEEEecccceeeeheec-c-CCceeeeeccCCcceeEEeccCceE
Confidence 4667899999999885 1788999999999999999988877776 6 6899999988654 67778889999
Q ss_pred EEEeCCCCeE-EEEeec--CCCCeeEEE------EccCCCEEEEecCcEEEEECCCCc--eeEEe-ecCCCCeEEEEECC
Q 036605 98 SEMKSEMGEV-IREFKA--SEKPISSSA------FLCEEKIFALASSEVRILSLENGE--EVLKF-SDDVGPLQYVSASD 165 (340)
Q Consensus 98 ~~wd~~~~~~-~~~~~~--~~~~i~~l~------~~~~~~~l~~~~~~i~i~d~~~~~--~~~~~-~~~~~~v~~~~~s~ 165 (340)
.+||++..+. +..+.+ ...+|..++ ..+.|-+|+.+...+..|...... ....+ .+.++.+.++++.+
T Consensus 261 lvyD~R~~~~~~~e~~a~~t~~pv~~i~~~~~n~~f~~gglLv~~lt~l~f~ei~~s~~~~p~vlele~pG~cismqy~~ 340 (463)
T KOG1645|consen 261 LVYDMRQPEGPLMELVANVTINPVHKIAPVQPNKIFTSGGLLVFALTVLQFYEIVFSAECLPCVLELEPPGICISMQYHG 340 (463)
T ss_pred EEEEccCCCchHhhhhhhhccCcceeecccCccccccccceEEeeehhhhhhhhhccccCCCcccccCCCcceeeeeecC
Confidence 9999986542 222222 123344333 233455555555556677654321 11111 22356677777777
Q ss_pred CCCEEEEEEc
Q 036605 166 GAKIIITAGY 175 (340)
Q Consensus 166 ~~~~l~s~~~ 175 (340)
..+.++.+..
T Consensus 341 ~snh~l~tyR 350 (463)
T KOG1645|consen 341 VSNHLLLTYR 350 (463)
T ss_pred ccceEEEEec
Confidence 6666665444
No 317
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=98.33 E-value=0.0001 Score=65.40 Aligned_cols=181 Identities=17% Similarity=0.176 Sum_probs=107.6
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEE-EEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCC-----
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAG-LAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKP----- 117 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~-v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~----- 117 (340)
.+++++.+|.++.+|.++|+.+++... . +.+.+ ... .+..++.+..++.+..+|..+|+.+..+......
T Consensus 122 ~v~v~~~~g~l~ald~~tG~~~W~~~~-~-~~~~ssP~v--~~~~v~v~~~~g~l~ald~~tG~~~W~~~~~~~~~~~~~ 197 (394)
T PRK11138 122 KVYIGSEKGQVYALNAEDGEVAWQTKV-A-GEALSRPVV--SDGLVLVHTSNGMLQALNESDGAVKWTVNLDVPSLTLRG 197 (394)
T ss_pred EEEEEcCCCEEEEEECCCCCCcccccC-C-CceecCCEE--ECCEEEEECCCCEEEEEEccCCCEeeeecCCCCcccccC
Confidence 577888999999999999999988764 2 22222 222 2456777888999999999999988776542111
Q ss_pred eeEEEEccCCCEEE-EecCcEEEEECCCCceeEEeecCC-C------CeEEEEECC--CCCEEEEEEcCCCeEEEEEccC
Q 036605 118 ISSSAFLCEEKIFA-LASSEVRILSLENGEEVLKFSDDV-G------PLQYVSASD--GAKIIITAGYGEKHLQVWRCDI 187 (340)
Q Consensus 118 i~~l~~~~~~~~l~-~~~~~i~i~d~~~~~~~~~~~~~~-~------~v~~~~~s~--~~~~l~s~~~~d~~i~iwd~~~ 187 (340)
..+..+. ++..++ ..++.+..+|..+|+.+-.+.... . ....+..+| .+..++.++. ++.+..+|.
T Consensus 198 ~~sP~v~-~~~v~~~~~~g~v~a~d~~~G~~~W~~~~~~~~~~~~~~~~~~~~~sP~v~~~~vy~~~~-~g~l~ald~-- 273 (394)
T PRK11138 198 ESAPATA-FGGAIVGGDNGRVSAVLMEQGQLIWQQRISQPTGATEIDRLVDVDTTPVVVGGVVYALAY-NGNLVALDL-- 273 (394)
T ss_pred CCCCEEE-CCEEEEEcCCCEEEEEEccCChhhheeccccCCCccchhcccccCCCcEEECCEEEEEEc-CCeEEEEEC--
Confidence 0111222 233332 245558888999887664432110 0 000011112 2345666566 888888887
Q ss_pred CCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 188 SSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 188 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
.+++..-... .... ... ...+..++.++.+|.++.+|..+++.+-
T Consensus 274 ~tG~~~W~~~--~~~~---~~~-----~~~~~~vy~~~~~g~l~ald~~tG~~~W 318 (394)
T PRK11138 274 RSGQIVWKRE--YGSV---NDF-----AVDGGRIYLVDQNDRVYALDTRGGVELW 318 (394)
T ss_pred CCCCEEEeec--CCCc---cCc-----EEECCEEEEEcCCCeEEEEECCCCcEEE
Confidence 4554322111 1110 001 1245678888899999999998876543
No 318
>KOG2041 consensus WD40 repeat protein [General function prediction only]
Probab=98.27 E-value=1.5e-05 Score=71.70 Aligned_cols=189 Identities=11% Similarity=0.075 Sum_probs=122.9
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEe-cCCCCCCeEEEEEecCCCEEEEEeCCCcE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKS-TGRHPGGLAGLAFAKKGRSLHVVGTNGMA 97 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~-~~~h~~~v~~v~~~~~~~~l~s~~~dg~i 97 (340)
+|...|.-+.|..+.+ -|-+...+|.|.+|-+-.|...... .....+-|.+++|+.||..+...-.||.|
T Consensus 69 GH~~sV~vvTWNe~~Q---------KLTtSDt~GlIiVWmlykgsW~EEMiNnRnKSvV~SmsWn~dG~kIcIvYeDGav 139 (1189)
T KOG2041|consen 69 GHNASVMVVTWNENNQ---------KLTTSDTSGLIIVWMLYKGSWCEEMINNRNKSVVVSMSWNLDGTKICIVYEDGAV 139 (1189)
T ss_pred cCcceEEEEEeccccc---------cccccCCCceEEEEeeecccHHHHHhhCcCccEEEEEEEcCCCcEEEEEEccCCE
Confidence 8999999999998876 5899999999999998888643322 22256678999999999999999999999
Q ss_pred EEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE--ecCcEEEEECCCCce--------e---EEeecCCCCeEEEEE-
Q 036605 98 SEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL--ASSEVRILSLENGEE--------V---LKFSDDVGPLQYVSA- 163 (340)
Q Consensus 98 ~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~--~~~~i~i~d~~~~~~--------~---~~~~~~~~~v~~~~~- 163 (340)
.+=.++.. .+..-.........+.|++|.+.++. +.+.+.+||....-. + ..+......+..+.|
T Consensus 140 IVGsvdGN-RIwgKeLkg~~l~hv~ws~D~~~~Lf~~ange~hlydnqgnF~~Kl~~~c~Vn~tg~~s~~~~kia~i~w~ 218 (1189)
T KOG2041|consen 140 IVGSVDGN-RIWGKELKGQLLAHVLWSEDLEQALFKKANGETHLYDNQGNFERKLEKDCEVNGTGIFSNFPTKIAEIEWN 218 (1189)
T ss_pred EEEeeccc-eecchhcchheccceeecccHHHHHhhhcCCcEEEecccccHHHhhhhceEEeeeeeecCCCccccceeec
Confidence 88776533 33221111223457889999876644 677799999754311 0 112222234555555
Q ss_pred -------CCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCC
Q 036605 164 -------SDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAES 227 (340)
Q Consensus 164 -------s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~d 227 (340)
.|+...|+.+-. .|.+.|..- ..... . ..+ ...-.+... -| +++|..|+.++.+
T Consensus 219 ~g~~~~v~pdrP~lavcy~-nGr~QiMR~--eND~~-P-vv~--dtgm~~vga--kW-nh~G~vLAvcG~~ 279 (1189)
T KOG2041|consen 219 TGPYQPVPPDRPRLAVCYA-NGRMQIMRS--ENDPE-P-VVV--DTGMKIVGA--KW-NHNGAVLAVCGND 279 (1189)
T ss_pred cCccccCCCCCCEEEEEEc-Cceehhhhh--cCCCC-C-eEE--ecccEeecc--ee-cCCCcEEEEccCc
Confidence 457778888666 888887653 22111 1 111 111122222 55 7888888887765
No 319
>KOG2114 consensus Vacuolar assembly/sorting protein PEP5/VPS11 [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.22 E-value=0.00015 Score=66.76 Aligned_cols=194 Identities=13% Similarity=0.157 Sum_probs=116.3
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCC-eEEEEEecCCCEEEEEeCCC-----c
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGG-LAGLAFAKKGRSLHVVGTNG-----M 96 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~-v~~v~~~~~~~~l~s~~~dg-----~ 96 (340)
.++| |++.+. .++.|+.+|.|.+++-. -+..+.++. +... |..+-...+.+.|++.+.|+ .
T Consensus 27 ~isc--~~s~~~---------~vvigt~~G~V~~Ln~s-~~~~~~fqa-~~~siv~~L~~~~~~~~L~sv~Ed~~~np~l 93 (933)
T KOG2114|consen 27 AISC--CSSSTG---------SVVIGTADGRVVILNSS-FQLIRGFQA-YEQSIVQFLYILNKQNFLFSVGEDEQGNPVL 93 (933)
T ss_pred ceeE--EcCCCc---------eEEEeeccccEEEeccc-ceeeehhee-cchhhhhHhhcccCceEEEEEeecCCCCceE
Confidence 5666 777776 79999999999999832 334466666 6555 55554444446888888774 4
Q ss_pred EEEEeCCCC---e---EE--EEee-----cCCCCeeEEEEccCCCEEEE--ecCcEEEEECC----CCceeEEeecCCCC
Q 036605 97 ASEMKSEMG---E---VI--REFK-----ASEKPISSSAFLCEEKIFAL--ASSEVRILSLE----NGEEVLKFSDDVGP 157 (340)
Q Consensus 97 i~~wd~~~~---~---~~--~~~~-----~~~~~i~~l~~~~~~~~l~~--~~~~i~i~d~~----~~~~~~~~~~~~~~ 157 (340)
+++|+++.. + .+ +.+. ....++++++++.+-+.+++ ++|.|.++.-. .+....-......+
T Consensus 94 lkiw~lek~~~n~sP~c~~~~ri~~~~np~~~~p~s~l~Vs~~l~~Iv~Gf~nG~V~~~~GDi~RDrgsr~~~~~~~~~p 173 (933)
T KOG2114|consen 94 LKIWDLEKVDKNNSPQCLYEHRIFTIKNPTNPSPASSLAVSEDLKTIVCGFTNGLVICYKGDILRDRGSRQDYSHRGKEP 173 (933)
T ss_pred EEEecccccCCCCCcceeeeeeeeccCCCCCCCcceEEEEEccccEEEEEecCcEEEEEcCcchhccccceeeeccCCCC
Confidence 899998643 1 12 1111 13567899999999877777 45557666421 11111111233579
Q ss_pred eEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 158 LQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 158 v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
|+.+.+..++..++.... ...|.+|.+ . ++..... ...+.+....+. ++ ++....+++++..+ +++|+...
T Consensus 174 ITgL~~~~d~~s~lFv~T-t~~V~~y~l--~-gr~p~~~--~ld~~G~~lnCs-s~-~~~t~qfIca~~e~-l~fY~sd~ 244 (933)
T KOG2114|consen 174 ITGLALRSDGKSVLFVAT-TEQVMLYSL--S-GRTPSLK--VLDNNGISLNCS-SF-SDGTYQFICAGSEF-LYFYDSDG 244 (933)
T ss_pred ceeeEEecCCceeEEEEe-cceeEEEEe--c-CCCccee--eeccCCccceee-ec-CCCCccEEEecCce-EEEEcCCC
Confidence 999999988887444445 678999998 3 2221111 123333333332 22 22222355555454 89998775
Q ss_pred C
Q 036605 238 V 238 (340)
Q Consensus 238 ~ 238 (340)
.
T Consensus 245 ~ 245 (933)
T KOG2114|consen 245 R 245 (933)
T ss_pred c
Confidence 3
No 320
>COG3391 Uncharacterized conserved protein [Function unknown]
Probab=98.20 E-value=0.0015 Score=57.50 Aligned_cols=198 Identities=13% Similarity=0.124 Sum_probs=132.7
Q ss_pred EEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeC---CCcEEEEe
Q 036605 25 SCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGT---NGMASEMK 101 (340)
Q Consensus 25 ~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~---dg~i~~wd 101 (340)
.+++.++.+. ..++....+..|.+.|..+.+......-+. ....++++++++.++.+.. ++.+.+.|
T Consensus 77 ~~i~v~~~~~--------~vyv~~~~~~~v~vid~~~~~~~~~~~vG~--~P~~~~~~~~~~~vYV~n~~~~~~~vsvid 146 (381)
T COG3391 77 AGVAVNPAGN--------KVYVTTGDSNTVSVIDTATNTVLGSIPVGL--GPVGLAVDPDGKYVYVANAGNGNNTVSVID 146 (381)
T ss_pred cceeeCCCCC--------eEEEecCCCCeEEEEcCcccceeeEeeecc--CCceEEECCCCCEEEEEecccCCceEEEEe
Confidence 4566666664 155666667899999988777666555322 5678999999998888766 68999999
Q ss_pred CCCCeEEEEeecCCCCeeEEEEccCCCEEEEec---CcEEEEECCCCceeE-E----eecCCCCeEEEEECCCCCEEEEE
Q 036605 102 SEMGEVIREFKASEKPISSSAFLCEEKIFALAS---SEVRILSLENGEEVL-K----FSDDVGPLQYVSASDGAKIIITA 173 (340)
Q Consensus 102 ~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~---~~i~i~d~~~~~~~~-~----~~~~~~~v~~~~~s~~~~~l~s~ 173 (340)
..+++..........+ ..++++|+|..++.++ +.|.++|........ . +.. ......+.++++|.+++..
T Consensus 147 ~~t~~~~~~~~vG~~P-~~~a~~p~g~~vyv~~~~~~~v~vi~~~~~~v~~~~~~~~~~~-~~~P~~i~v~~~g~~~yV~ 224 (381)
T COG3391 147 AATNKVTATIPVGNTP-TGVAVDPDGNKVYVTNSDDNTVSVIDTSGNSVVRGSVGSLVGV-GTGPAGIAVDPDGNRVYVA 224 (381)
T ss_pred CCCCeEEEEEecCCCc-ceEEECCCCCeEEEEecCCCeEEEEeCCCcceecccccccccc-CCCCceEEECCCCCEEEEE
Confidence 9999888875554445 8899999999776644 339999977664442 1 111 2334678999999988876
Q ss_pred EcCC--CeEEEEEccCCCCCccCC-ceeeecCCCeeeeeecCCCCCCCCEEEEEeC-CCcEEEEECCCCCccC
Q 036605 174 GYGE--KHLQVWRCDISSKTVNKG-PALSMRHSPVAIDCKNSPNGEDGTVILAVAE-SGVAYSWDLKTVSQDE 242 (340)
Q Consensus 174 ~~~d--~~i~iwd~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~-dg~i~vwd~~~~~~~~ 242 (340)
...+ +.+.+.|. ..+..... ...... .+..... .|+|.++.+... .+.+.+.|..+.....
T Consensus 225 ~~~~~~~~v~~id~--~~~~v~~~~~~~~~~-~~~~v~~-----~p~g~~~yv~~~~~~~V~vid~~~~~v~~ 289 (381)
T COG3391 225 NDGSGSNNVLKIDT--ATGNVTATDLPVGSG-APRGVAV-----DPAGKAAYVANSQGGTVSVIDGATDRVVK 289 (381)
T ss_pred eccCCCceEEEEeC--CCceEEEeccccccC-CCCceeE-----CCCCCEEEEEecCCCeEEEEeCCCCceee
Confidence 6644 47777776 33322211 111111 2233333 788888877744 4789999888754443
No 321
>PF06977 SdiA-regulated: SdiA-regulated; InterPro: IPR009722 This entry represents a conserved region approximately 100 residues long within a number of hypothetical bacterial proteins that may be regulated by SdiA, a member of the LuxR family of transcriptional regulators []. Some proteins contain the IPR001258 from INTERPRO repeat.; PDB: 3QQZ_A.
Probab=98.19 E-value=0.0022 Score=52.31 Aligned_cols=157 Identities=13% Similarity=0.106 Sum_probs=92.4
Q ss_pred CCCCCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcE
Q 036605 19 EPVVSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMA 97 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i 97 (340)
+....++.|+|.|+. + ++++....+.|..++. +|+.+.++.-...+..-+|++..++.++++--.++.+
T Consensus 19 g~~~e~SGLTy~pd~~t---------LfaV~d~~~~i~els~-~G~vlr~i~l~g~~D~EgI~y~g~~~~vl~~Er~~~L 88 (248)
T PF06977_consen 19 GILDELSGLTYNPDTGT---------LFAVQDEPGEIYELSL-DGKVLRRIPLDGFGDYEGITYLGNGRYVLSEERDQRL 88 (248)
T ss_dssp T--S-EEEEEEETTTTE---------EEEEETTTTEEEEEET-T--EEEEEE-SS-SSEEEEEE-STTEEEEEETTTTEE
T ss_pred CccCCccccEEcCCCCe---------EEEEECCCCEEEEEcC-CCCEEEEEeCCCCCCceeEEEECCCEEEEEEcCCCcE
Confidence 555679999999985 6 7888888899999996 4777777754234578889998777776665568899
Q ss_pred EEEeCCCCe------EEEEee-----cCCCCeeEEEEccCCCEEEEecCc--EEEEECCC---CceeEEe--------ec
Q 036605 98 SEMKSEMGE------VIREFK-----ASEKPISSSAFLCEEKIFALASSE--VRILSLEN---GEEVLKF--------SD 153 (340)
Q Consensus 98 ~~wd~~~~~------~~~~~~-----~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~---~~~~~~~--------~~ 153 (340)
.++++.... ....+. .+...+-.++|+|.+..|+++... ..+|.+.. ...+... ..
T Consensus 89 ~~~~~~~~~~~~~~~~~~~~~l~~~~~~N~G~EGla~D~~~~~L~v~kE~~P~~l~~~~~~~~~~~~~~~~~~~~~~~~~ 168 (248)
T PF06977_consen 89 YIFTIDDDTTSLDRADVQKISLGFPNKGNKGFEGLAYDPKTNRLFVAKERKPKRLYEVNGFPGGFDLFVSDDQDLDDDKL 168 (248)
T ss_dssp EEEEE----TT--EEEEEEEE---S---SS--EEEEEETTTTEEEEEEESSSEEEEEEESTT-SS--EEEE-HHHH-HT-
T ss_pred EEEEEeccccccchhhceEEecccccCCCcceEEEEEcCCCCEEEEEeCCCChhhEEEccccCccceeeccccccccccc
Confidence 988873321 111221 244568999999987766554332 55555543 2111111 12
Q ss_pred CCCCeEEEEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 154 DVGPLQYVSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 154 ~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
....+.++.++|....|+.-+.....|.++|.
T Consensus 169 ~~~d~S~l~~~p~t~~lliLS~es~~l~~~d~ 200 (248)
T PF06977_consen 169 FVRDLSGLSYDPRTGHLLILSDESRLLLELDR 200 (248)
T ss_dssp -SS---EEEEETTTTEEEEEETTTTEEEEE-T
T ss_pred eeccccceEEcCCCCeEEEEECCCCeEEEECC
Confidence 33567889998876666655665888888885
No 322
>PRK02888 nitrous-oxide reductase; Validated
Probab=98.19 E-value=0.00086 Score=61.00 Aligned_cols=100 Identities=12% Similarity=0.155 Sum_probs=70.1
Q ss_pred ecCCCEEEEEeCCCcEEEEeCCC----C-eEEEEeecCCCCeeEEEEccCCCEEEEecC---cEEEEECCCCce------
Q 036605 82 AKKGRSLHVVGTNGMASEMKSEM----G-EVIREFKASEKPISSSAFLCEEKIFALASS---EVRILSLENGEE------ 147 (340)
Q Consensus 82 ~~~~~~l~s~~~dg~i~~wd~~~----~-~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~---~i~i~d~~~~~~------ 147 (340)
.++|++.+. .++.|.++|..+ + ..+..+.. ....+.+.++|||+++++++. ++.++|+.+.+.
T Consensus 285 vkdGK~~~V--~gn~V~VID~~t~~~~~~~v~~yIPV-GKsPHGV~vSPDGkylyVanklS~tVSVIDv~k~k~~~~~~~ 361 (635)
T PRK02888 285 VKAGKFKTI--GGSKVPVVDGRKAANAGSALTRYVPV-PKNPHGVNTSPDGKYFIANGKLSPTVTVIDVRKLDDLFDGKI 361 (635)
T ss_pred hhCCCEEEE--CCCEEEEEECCccccCCcceEEEEEC-CCCccceEECCCCCEEEEeCCCCCcEEEEEChhhhhhhhccC
Confidence 457777665 356899999988 3 44444543 445689999999999988654 399999987653
Q ss_pred ------eEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 148 ------VLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 148 ------~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
..+..--.+ ....+|+++|....+ -.-|..|..|++.
T Consensus 362 ~~~~~vvaevevGlG-PLHTaFDg~G~ayts-lf~dsqv~kwn~~ 404 (635)
T PRK02888 362 KPRDAVVAEPELGLG-PLHTAFDGRGNAYTT-LFLDSQIVKWNIE 404 (635)
T ss_pred CccceEEEeeccCCC-cceEEECCCCCEEEe-EeecceeEEEehH
Confidence 233332223 356789999875444 4449999999984
No 323
>KOG1920 consensus IkappaB kinase complex, IKAP component [Transcription]
Probab=98.15 E-value=0.00022 Score=68.18 Aligned_cols=155 Identities=17% Similarity=0.176 Sum_probs=99.4
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEc----cC-------------------CeeEEEecC-----
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDV----LT-------------------GEMKWKSTG----- 70 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~----~~-------------------~~~~~~~~~----- 70 (340)
..+..|.+++||||+. +++..+..+++.+-.- -. |+....+.+
T Consensus 107 ~vd~GI~aaswS~Dee---------~l~liT~~~tll~mT~~f~~i~E~~L~~d~~~~sk~v~VGwGrkeTqfrgs~gr~ 177 (1265)
T KOG1920|consen 107 NVDNGISAASWSPDEE---------LLALITGRQTLLFMTKDFEPIAEKPLDADDERKSKFVNVGWGRKETQFRGSEGRQ 177 (1265)
T ss_pred eccCceEEEeecCCCc---------EEEEEeCCcEEEEEeccccchhccccccccccccccceecccccceeeecchhhh
Confidence 4568899999999999 8999988888876432 00 111111211
Q ss_pred ------CCC---------CCeEEEEEecCCCEEEEEe----CC-CcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEE
Q 036605 71 ------RHP---------GGLAGLAFAKKGRSLHVVG----TN-GMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIF 130 (340)
Q Consensus 71 ------~h~---------~~v~~v~~~~~~~~l~s~~----~d-g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l 130 (340)
.+. ..=+.|+|--||.++++.. .+ ..|++||-+ |..-..-.....--.+++|-|.|..+
T Consensus 178 ~~~~~~~~ek~~~~~~~~~~~~~IsWRgDg~~fAVs~~~~~~~~RkirV~drE-g~Lns~se~~~~l~~~LsWkPsgs~i 256 (1265)
T KOG1920|consen 178 AARQKIEKEKALEQIEQDDHKTSISWRGDGEYFAVSFVESETGTRKIRVYDRE-GALNSTSEPVEGLQHSLSWKPSGSLI 256 (1265)
T ss_pred cccccccccccccchhhccCCceEEEccCCcEEEEEEEeccCCceeEEEeccc-chhhcccCcccccccceeecCCCCeE
Confidence 000 1123589999999888732 23 789999976 54332222223345689999999999
Q ss_pred EE-----ecCcEEEEECCCCce----eEEeecCCCCeEEEEECCCCCEEEE---EEcCCCeEEEEEc
Q 036605 131 AL-----ASSEVRILSLENGEE----VLKFSDDVGPLQYVSASDGAKIIIT---AGYGEKHLQVWRC 185 (340)
Q Consensus 131 ~~-----~~~~i~i~d~~~~~~----~~~~~~~~~~v~~~~~s~~~~~l~s---~~~~d~~i~iwd~ 185 (340)
++ .+++|.+|.- +|-. ...+......+..++|+.++..|+. ... ...|++|-+
T Consensus 257 A~iq~~~sd~~IvffEr-NGL~hg~f~l~~p~de~~ve~L~Wns~sdiLAv~~~~~e-~~~v~lwt~ 321 (1265)
T KOG1920|consen 257 AAIQCKTSDSDIVFFER-NGLRHGEFVLPFPLDEKEVEELAWNSNSDILAVVTSNLE-NSLVQLWTT 321 (1265)
T ss_pred eeeeecCCCCcEEEEec-CCccccccccCCcccccchheeeecCCCCceeeeecccc-cceEEEEEe
Confidence 87 2233888873 3322 2233444455899999999987776 333 455999987
No 324
>KOG3617 consensus WD40 and TPR repeat-containing protein [General function prediction only]
Probab=98.14 E-value=1.2e-05 Score=73.67 Aligned_cols=107 Identities=15% Similarity=0.155 Sum_probs=84.5
Q ss_pred EEEEeeccccccccccCceEEEEEc----CCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEE
Q 036605 25 SCLACGFVGKKRRKERGTLLLALGT----SNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEM 100 (340)
Q Consensus 25 ~~l~~sp~~~~~~~~~~~~~l~~g~----~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~w 100 (340)
+-..|+|... ++|+++ ..|.|.||- ++|++..... .+-.+++++|+|..-.|+.|-.-|.+.+|
T Consensus 19 ti~SWHPseP---------lfAVA~fS~er~GSVtIfa-dtGEPqr~Vt--~P~hatSLCWHpe~~vLa~gwe~g~~~v~ 86 (1416)
T KOG3617|consen 19 TISSWHPSEP---------LFAVASFSPERGGSVTIFA-DTGEPQRDVT--YPVHATSLCWHPEEFVLAQGWEMGVSDVQ 86 (1416)
T ss_pred cccccCCCCc---------eeEEEEecCCCCceEEEEe-cCCCCCcccc--cceehhhhccChHHHHHhhccccceeEEE
Confidence 4467999988 888876 458898884 5676554443 33456789999988888888888999999
Q ss_pred eCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECC
Q 036605 101 KSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLE 143 (340)
Q Consensus 101 d~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~ 143 (340)
...+.+.-.....|..+|..+.|||+|..+++++.- +.+|.+.
T Consensus 87 ~~~~~e~htv~~th~a~i~~l~wS~~G~~l~t~d~~g~v~lwr~d 131 (1416)
T KOG3617|consen 87 KTNTTETHTVVETHPAPIQGLDWSHDGTVLMTLDNPGSVHLWRYD 131 (1416)
T ss_pred ecCCceeeeeccCCCCCceeEEecCCCCeEEEcCCCceeEEEEee
Confidence 988776655566789999999999999999998765 8888765
No 325
>KOG3621 consensus WD40 repeat-containing protein [General function prediction only]
Probab=98.13 E-value=3.4e-05 Score=69.29 Aligned_cols=115 Identities=14% Similarity=0.092 Sum_probs=82.7
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEE
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEM 100 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~w 100 (340)
...|.--++...++ +++.|+..|.+++|+-..+.....-.+.-.+.+..++.+++..+++.|+..|.|.++
T Consensus 33 ~~~v~lTc~dst~~---------~l~~GsS~G~lyl~~R~~~~~~~~~~~~~~~~~~~~~vs~~e~lvAagt~~g~V~v~ 103 (726)
T KOG3621|consen 33 PARVKLTCVDATEE---------YLAMGSSAGSVYLYNRHTGEMRKLKNEGATGITCVRSVSSVEYLVAAGTASGRVSVF 103 (726)
T ss_pred cceEEEEEeecCCc---------eEEEecccceEEEEecCchhhhcccccCccceEEEEEecchhHhhhhhcCCceEEee
Confidence 33444444555577 999999999999999877764332222244566777888888889999999999999
Q ss_pred eCCCCeEE-----EEe-ecCCCCeeEEEEccCCCEEEEecCc--EEEEECCC
Q 036605 101 KSEMGEVI-----REF-KASEKPISSSAFLCEEKIFALASSE--VRILSLEN 144 (340)
Q Consensus 101 d~~~~~~~-----~~~-~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~ 144 (340)
-+..+.+- ... +.|+..|++++|++++..+++|+.. |.+..+.+
T Consensus 104 ql~~~~p~~~~~~t~~d~~~~~rVTal~Ws~~~~k~ysGD~~Gkv~~~~L~s 155 (726)
T KOG3621|consen 104 QLNKELPRDLDYVTPCDKSHKCRVTALEWSKNGMKLYSGDSQGKVVLTELDS 155 (726)
T ss_pred hhhccCCCcceeeccccccCCceEEEEEecccccEEeecCCCceEEEEEech
Confidence 87654321 111 2367789999999999999998877 66665555
No 326
>PF11768 DUF3312: Protein of unknown function (DUF3312); InterPro: IPR024511 This is a eukaryotic family of uncharacterised proteins that contain WD40 repeats.
Probab=98.08 E-value=5.4e-05 Score=66.91 Aligned_cols=89 Identities=11% Similarity=0.080 Sum_probs=66.7
Q ss_pred EEEEccCCeeEE--EecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE
Q 036605 55 LAVDVLTGEMKW--KSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL 132 (340)
Q Consensus 55 ~i~d~~~~~~~~--~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~ 132 (340)
.+|+...++..+ ...-..+..|.+++++|+...|+.|+.||.|.+||...+.. .+....-.++.++|+|+|.++++
T Consensus 239 ciYE~~r~klqrvsvtsipL~s~v~~ca~sp~E~kLvlGC~DgSiiLyD~~~~~t--~~~ka~~~P~~iaWHp~gai~~V 316 (545)
T PF11768_consen 239 CIYECSRNKLQRVSVTSIPLPSQVICCARSPSEDKLVLGCEDGSIILYDTTRGVT--LLAKAEFIPTLIAWHPDGAIFVV 316 (545)
T ss_pred EEEEeecCceeEEEEEEEecCCcceEEecCcccceEEEEecCCeEEEEEcCCCee--eeeeecccceEEEEcCCCcEEEE
Confidence 456665554221 11113778999999999999999999999999999876643 23334456789999999999988
Q ss_pred ecCc--EEEEECCCC
Q 036605 133 ASSE--VRILSLENG 145 (340)
Q Consensus 133 ~~~~--i~i~d~~~~ 145 (340)
++.. +.+||+.-.
T Consensus 317 ~s~qGelQ~FD~ALs 331 (545)
T PF11768_consen 317 GSEQGELQCFDMALS 331 (545)
T ss_pred EcCCceEEEEEeecC
Confidence 7765 999998654
No 327
>KOG0882 consensus Cyclophilin-related peptidyl-prolyl cis-trans isomerase [Posttranslational modification, protein turnover, chaperones]
Probab=98.07 E-value=3.2e-05 Score=65.89 Aligned_cols=210 Identities=11% Similarity=0.081 Sum_probs=131.7
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC--C-eeEEEecCCCCCCeEEEEEecCCCEEEEEeC-CC
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT--G-EMKWKSTGRHPGGLAGLAFAKKGRSLHVVGT-NG 95 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~--~-~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~-dg 95 (340)
|...|+-+..+. .+ ++.+++.||.++.|.-.. | +.+..+.. |.+.|.+++.+-++..+.+.+. |.
T Consensus 8 hrd~i~hv~~tk-a~---------fiiqASlDGh~KFWkKs~isGvEfVKhFra-HL~~I~sl~~S~dg~L~~Sv~d~Dh 76 (558)
T KOG0882|consen 8 HRDVITHVFPTK-AK---------FIIQASLDGHKKFWKKSRISGVEFVKHFRA-HLGVILSLAVSYDGWLFRSVEDPDH 76 (558)
T ss_pred ccceeeeEeeeh-hh---------eEEeeecchhhhhcCCCCccceeehhhhHH-HHHHHHhhhccccceeEeeccCccc
Confidence 555565544432 24 899999999999997543 2 12223333 8888999999999999999777 99
Q ss_pred cEEEEeCCCCeEEEEeecCCCCeeEEEEccCC---CEEEEe---cCcEEEEECCCCc-ee-EEeecCCCCeEEEEECCCC
Q 036605 96 MASEMKSEMGEVIREFKASEKPISSSAFLCEE---KIFALA---SSEVRILSLENGE-EV-LKFSDDVGPLQYVSASDGA 167 (340)
Q Consensus 96 ~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~---~~l~~~---~~~i~i~d~~~~~-~~-~~~~~~~~~v~~~~~s~~~ 167 (340)
.++++|+.+-..+..++...-+-.+-.+...| ..+++. ++.+.++|-.... .. ..-.-|..+|..+.+.+.+
T Consensus 77 s~KvfDvEn~DminmiKL~~lPg~a~wv~skGd~~s~IAVs~~~sg~i~VvD~~~d~~q~~~fkklH~sPV~~i~y~qa~ 156 (558)
T KOG0882|consen 77 SVKVFDVENFDMINMIKLVDLPGFAEWVTSKGDKISLIAVSLFKSGKIFVVDGFGDFCQDGYFKKLHFSPVKKIRYNQAG 156 (558)
T ss_pred ceeEEEeeccchhhhcccccCCCceEEecCCCCeeeeEEeecccCCCcEEECCcCCcCccceecccccCceEEEEeeccc
Confidence 99999998766553333211111111122222 123332 3338899976543 22 3336688999999999999
Q ss_pred CEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeee-------ec-CCCCCCCCEEEEEeCCCcEEEEECCCCC
Q 036605 168 KIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDC-------KN-SPNGEDGTVILAVAESGVAYSWDLKTVS 239 (340)
Q Consensus 168 ~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~-------~~-~~~~~~~~~l~~~s~dg~i~vwd~~~~~ 239 (340)
..+++... .|.|.-|.....-+.....+.+.+.|....... .+ .+ ++++..+.+-+.|..|+++++++++
T Consensus 157 Ds~vSiD~-~gmVEyWs~e~~~qfPr~~l~~~~K~eTdLy~f~K~Kt~pts~Ef-sp~g~qistl~~DrkVR~F~~KtGk 234 (558)
T KOG0882|consen 157 DSAVSIDI-SGMVEYWSAEGPFQFPRTNLNFELKHETDLYGFPKAKTEPTSFEF-SPDGAQISTLNPDRKVRGFVFKTGK 234 (558)
T ss_pred cceeeccc-cceeEeecCCCcccCccccccccccccchhhcccccccCccceEE-ccccCcccccCcccEEEEEEeccch
Confidence 98888665 899999997310011111122222222111100 00 22 8999999999999999999999866
Q ss_pred ccC
Q 036605 240 QDE 242 (340)
Q Consensus 240 ~~~ 242 (340)
...
T Consensus 235 lvq 237 (558)
T KOG0882|consen 235 LVQ 237 (558)
T ss_pred hhh
Confidence 554
No 328
>KOG1008 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=98.06 E-value=1.3e-06 Score=77.20 Aligned_cols=204 Identities=13% Similarity=0.126 Sum_probs=120.7
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeE-EEecCCCCCCeEEEEEec-CCCEEEEEe----CCC
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMK-WKSTGRHPGGLAGLAFAK-KGRSLHVVG----TNG 95 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~-~~~~~~h~~~v~~v~~~~-~~~~l~s~~----~dg 95 (340)
.-+.|+++.-+.. + .++++|..+|.|.+-.+....-. +.+...|....++++|++ |.+.|+.|- .|.
T Consensus 57 qy~kcva~~y~~d-~------cIlavG~atG~I~l~s~r~~hdSs~E~tp~~ar~Ct~lAwneLDtn~LAagldkhrnds 129 (783)
T KOG1008|consen 57 QYVKCVASFYGND-R------CILAVGSATGNISLLSVRHPHDSSAEVTPGYARPCTSLAWNELDTNHLAAGLDKHRNDS 129 (783)
T ss_pred CCceeehhhcCCc-h------hhhhhccccCceEEeecCCcccccceecccccccccccccccccHHHHHhhhhhhcccC
Confidence 3567888865442 1 28999999999999887655422 444444888999999998 556676652 356
Q ss_pred cEEEEeCCCC--eEEEE--eec-CCCCeeEEEEccCCCEEEEecC--cEEEEECCCCcee-EEeecCCCCeEEEEECC-C
Q 036605 96 MASEMKSEMG--EVIRE--FKA-SEKPISSSAFLCEEKIFALASS--EVRILSLENGEEV-LKFSDDVGPLQYVSASD-G 166 (340)
Q Consensus 96 ~i~~wd~~~~--~~~~~--~~~-~~~~i~~l~~~~~~~~l~~~~~--~i~i~d~~~~~~~-~~~~~~~~~v~~~~~s~-~ 166 (340)
.+.+||+.++ .+... |.. ......+++|..+.+.+.+|.. .+.++|++..... ..+ ....+..+..+| .
T Consensus 130 ~~~Iwdi~s~ltvPke~~~fs~~~l~gqns~cwlrd~klvlaGm~sr~~~ifdlRqs~~~~~sv--nTk~vqG~tVdp~~ 207 (783)
T KOG1008|consen 130 SLKIWDINSLLTVPKESPLFSSSTLDGQNSVCWLRDTKLVLAGMTSRSVHIFDLRQSLDSVSSV--NTKYVQGITVDPFS 207 (783)
T ss_pred CccceecccccCCCccccccccccccCccccccccCcchhhcccccchhhhhhhhhhhhhhhhh--hhhhcccceecCCC
Confidence 7999999887 33222 222 2334568888888888777443 3999999843221 122 223566677777 5
Q ss_pred CCEEEEEEcCCCeEEEEEccCCCCCccCCcee-eecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 167 AKIIITAGYGEKHLQVWRCDISSKTVNKGPAL-SMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 167 ~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
+.|+.+ .. |+.|.+||-...-........- ....+.....+..+. ...|...+.--..+.|+++++..
T Consensus 208 ~nY~cs-~~-dg~iAiwD~~rnienpl~~i~~~~N~~~~~l~~~aycP-trtglla~l~RdS~tIrlydi~~ 276 (783)
T KOG1008|consen 208 PNYFCS-NS-DGDIAIWDTYRNIENPLQIILRNENKKPKQLFALAYCP-TRTGLLAVLSRDSITIRLYDICV 276 (783)
T ss_pred CCceec-cc-cCceeeccchhhhccHHHHHhhCCCCcccceeeEEecc-CCcchhhhhccCcceEEEecccc
Confidence 667666 55 8999999931111111111110 001111233442232 22444333344457899998764
No 329
>PF03178 CPSF_A: CPSF A subunit region; InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=98.05 E-value=0.0034 Score=54.02 Aligned_cols=174 Identities=13% Similarity=0.157 Sum_probs=96.5
Q ss_pred ccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcC---------C-CcEEEEEccCC-----eeEE
Q 036605 2 WSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTS---------N-GDILAVDVLTG-----EMKW 66 (340)
Q Consensus 2 wd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~---------d-g~i~i~d~~~~-----~~~~ 66 (340)
.|..+.+.+..+.-. ....++|++...-.... .....++++|+. . |.|.+|++... +...
T Consensus 7 ~d~~~~~~~~~~~l~---~~E~~~s~~~~~l~~~~--~~~~~~ivVGT~~~~~~~~~~~~Gri~v~~i~~~~~~~~~l~~ 81 (321)
T PF03178_consen 7 VDPTTFEVLDSFELE---PNEHVTSLCSVKLKGDS--TGKKEYIVVGTAFNYGEDPEPSSGRILVFEISESPENNFKLKL 81 (321)
T ss_dssp EETTTSSEEEEEEEE---TTEEEEEEEEEEETTS-----SSEEEEEEEEE--TTSSS-S-EEEEEEEECSS-----EEEE
T ss_pred EeCCCCeEEEEEECC---CCceEEEEEEEEEcCcc--ccccCEEEEEecccccccccccCcEEEEEEEEcccccceEEEE
Confidence 466666666555422 33555555543211000 000128888764 2 89999999884 3222
Q ss_pred EecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCe-EEEEee-cCCCCeeEEEEccCCCEEEEecCc--EEEEEC
Q 036605 67 KSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGE-VIREFK-ASEKPISSSAFLCEEKIFALASSE--VRILSL 142 (340)
Q Consensus 67 ~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~-~~~~~~-~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~ 142 (340)
.......++|++++-- .+ .|+. +.++.|.+|++...+ ....-. .....+.++... +.+++++|-. +.++..
T Consensus 82 i~~~~~~g~V~ai~~~-~~-~lv~-~~g~~l~v~~l~~~~~l~~~~~~~~~~~i~sl~~~--~~~I~vgD~~~sv~~~~~ 156 (321)
T PF03178_consen 82 IHSTEVKGPVTAICSF-NG-RLVV-AVGNKLYVYDLDNSKTLLKKAFYDSPFYITSLSVF--KNYILVGDAMKSVSLLRY 156 (321)
T ss_dssp EEEEEESS-EEEEEEE-TT-EEEE-EETTEEEEEEEETTSSEEEEEEE-BSSSEEEEEEE--TTEEEEEESSSSEEEEEE
T ss_pred EEEEeecCcceEhhhh-CC-EEEE-eecCEEEEEEccCcccchhhheecceEEEEEEecc--ccEEEEEEcccCEEEEEE
Confidence 2222267889999876 34 4444 334789999988777 443322 223345555544 5577776644 555533
Q ss_pred CC-CceeEEe--ecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 143 EN-GEEVLKF--SDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 143 ~~-~~~~~~~--~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
.. ...+..+ ......++++.|-+++..++.+.. +|.+.++..+
T Consensus 157 ~~~~~~l~~va~d~~~~~v~~~~~l~d~~~~i~~D~-~gnl~~l~~~ 202 (321)
T PF03178_consen 157 DEENNKLILVARDYQPRWVTAAEFLVDEDTIIVGDK-DGNLFVLRYN 202 (321)
T ss_dssp ETTTE-EEEEEEESS-BEEEEEEEE-SSSEEEEEET-TSEEEEEEE-
T ss_pred EccCCEEEEEEecCCCccEEEEEEecCCcEEEEEcC-CCeEEEEEEC
Confidence 32 2223333 223456888888866666666555 9999999985
No 330
>KOG0882 consensus Cyclophilin-related peptidyl-prolyl cis-trans isomerase [Posttranslational modification, protein turnover, chaperones]
Probab=98.04 E-value=4.2e-05 Score=65.18 Aligned_cols=205 Identities=14% Similarity=0.028 Sum_probs=130.0
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcC-CCcEEEEEccCCeeEE--EecCCCCCCeEEEEEecC-CC-EEEEE-eC
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTS-NGDILAVDVLTGEMKW--KSTGRHPGGLAGLAFAKK-GR-SLHVV-GT 93 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~-dg~i~i~d~~~~~~~~--~~~~~h~~~v~~v~~~~~-~~-~l~s~-~~ 93 (340)
|-..+.+++.+-++. ++++++. |..++++|+++-.... ++.. -++.+..+. ++. -. .++.. -.
T Consensus 52 HL~~I~sl~~S~dg~---------L~~Sv~d~Dhs~KvfDvEn~DminmiKL~~-lPg~a~wv~-skGd~~s~IAVs~~~ 120 (558)
T KOG0882|consen 52 HLGVILSLAVSYDGW---------LFRSVEDPDHSVKVFDVENFDMINMIKLVD-LPGFAEWVT-SKGDKISLIAVSLFK 120 (558)
T ss_pred HHHHHHhhhccccce---------eEeeccCcccceeEEEeeccchhhhccccc-CCCceEEec-CCCCeeeeEEeeccc
Confidence 555677788888888 8888777 9999999998765442 2222 233332221 221 11 33333 35
Q ss_pred CCcEEEEeCCCCe--EEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCC------Cc---------eeEEeecC
Q 036605 94 NGMASEMKSEMGE--VIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLEN------GE---------EVLKFSDD 154 (340)
Q Consensus 94 dg~i~~wd~~~~~--~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~------~~---------~~~~~~~~ 154 (340)
+|.+.++|-.... ....-+.|..+|.++.+.+.+..+++.+.. |.-|.... .+ -+..+...
T Consensus 121 sg~i~VvD~~~d~~q~~~fkklH~sPV~~i~y~qa~Ds~vSiD~~gmVEyWs~e~~~qfPr~~l~~~~K~eTdLy~f~K~ 200 (558)
T KOG0882|consen 121 SGKIFVVDGFGDFCQDGYFKKLHFSPVKKIRYNQAGDSAVSIDISGMVEYWSAEGPFQFPRTNLNFELKHETDLYGFPKA 200 (558)
T ss_pred CCCcEEECCcCCcCccceecccccCceEEEEeeccccceeeccccceeEeecCCCcccCccccccccccccchhhccccc
Confidence 6999999966443 233344688899999999999988886543 88888762 11 11222334
Q ss_pred CCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCce-------------eeec---------------CCCee
Q 036605 155 VGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPA-------------LSMR---------------HSPVA 206 (340)
Q Consensus 155 ~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~-------------~~~~---------------~~~~~ 206 (340)
.....++.|+|++..+.+.+. |..|+++++. ++.....+. ..+. .....
T Consensus 201 Kt~pts~Efsp~g~qistl~~-DrkVR~F~~K--tGklvqeiDE~~t~~~~q~ks~y~l~~VelgRRmaverelek~~~~ 277 (558)
T KOG0882|consen 201 KTEPTSFEFSPDGAQISTLNP-DRKVRGFVFK--TGKLVQEIDEVLTDAQYQPKSPYGLMHVELGRRMAVERELEKHGST 277 (558)
T ss_pred ccCccceEEccccCcccccCc-ccEEEEEEec--cchhhhhhhccchhhhhccccccccceeehhhhhhHHhhHhhhcCc
Confidence 466789999999999999887 9999999983 332221110 0000 00111
Q ss_pred eeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCc
Q 036605 207 IDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQ 240 (340)
Q Consensus 207 ~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~ 240 (340)
.....+| ...+.+|+-|+-=| |++.++.+...
T Consensus 278 ~~~~~~f-des~~flly~t~~g-ikvin~~tn~v 309 (558)
T KOG0882|consen 278 VGTNAVF-DESGNFLLYGTILG-IKVINLDTNTV 309 (558)
T ss_pred ccceeEE-cCCCCEEEeeccee-EEEEEeecCeE
Confidence 1112244 67789999999888 99999887443
No 331
>PF08553 VID27: VID27 cytoplasmic protein; InterPro: IPR013863 This entry represents fungal and plant proteins and contains many hypothetical proteins. Vid27p is a cytoplasmic protein of unknown function, possibly regulates import of fructose-1,6-bisphosphatase into Vacuolar Import and Degradation (Vid) vesicles and is not essential for proteasome-dependent degradation of fructose-1,6-bisphosphatase (FBPase) [, ].
Probab=98.03 E-value=0.0011 Score=62.45 Aligned_cols=139 Identities=10% Similarity=0.079 Sum_probs=96.5
Q ss_pred EEEE-EcCCCcEEEEEccCCeeEEEecCCCC-CCeEEEEEec-----CCCEEEEEeCCCcEEEEeCCCCe--EEEE-e--
Q 036605 44 LLAL-GTSNGDILAVDVLTGEMKWKSTGRHP-GGLAGLAFAK-----KGRSLHVVGTNGMASEMKSEMGE--VIRE-F-- 111 (340)
Q Consensus 44 ~l~~-g~~dg~i~i~d~~~~~~~~~~~~~h~-~~v~~v~~~~-----~~~~l~s~~~dg~i~~wd~~~~~--~~~~-~-- 111 (340)
+|+. ......|+-.|++.|+.+..+.. |. .+|..++-.. .....+.|-.+..+..||++-.. .+.. .
T Consensus 495 mil~~~~~~~~ly~mDLe~GKVV~eW~~-~~~~~v~~~~p~~K~aqlt~e~tflGls~n~lfriDpR~~~~k~v~~~~k~ 573 (794)
T PF08553_consen 495 MILLDPNNPNKLYKMDLERGKVVEEWKV-HDDIPVVDIAPDSKFAQLTNEQTFLGLSDNSLFRIDPRLSGNKLVDSQSKQ 573 (794)
T ss_pred eEeecCCCCCceEEEecCCCcEEEEeec-CCCcceeEecccccccccCCCceEEEECCCceEEeccCCCCCceeeccccc
Confidence 4444 34567899999999999998887 44 3355554321 13356677788899999988642 2211 1
Q ss_pred ecCCCCeeEEEEccCCCEEEE-ecCcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 112 KASEKPISSSAFLCEEKIFAL-ASSEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 112 ~~~~~~i~~l~~~~~~~~l~~-~~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
.......+|++-+.+|.+++. ..|+|++||--..+....+.+-..+|.+|..+.||+++++++ +..+.+++.
T Consensus 574 Y~~~~~Fs~~aTt~~G~iavgs~~G~IRLyd~~g~~AKT~lp~lG~pI~~iDvt~DGkwilaTc--~tyLlLi~t 646 (794)
T PF08553_consen 574 YSSKNNFSCFATTEDGYIAVGSNKGDIRLYDRLGKRAKTALPGLGDPIIGIDVTADGKWILATC--KTYLLLIDT 646 (794)
T ss_pred cccCCCceEEEecCCceEEEEeCCCcEEeecccchhhhhcCCCCCCCeeEEEecCCCcEEEEee--cceEEEEEE
Confidence 123456789999998877644 667799999433333344567779999999999999999865 478888876
No 332
>KOG4649 consensus PQQ (pyrrolo-quinoline quinone) repeat protein [Secondary metabolites biosynthesis, transport and catabolism]
Probab=98.02 E-value=0.003 Score=50.57 Aligned_cols=92 Identities=13% Similarity=0.166 Sum_probs=66.3
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEE
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAF 123 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~ 123 (340)
+++.|+..|.+++.+..+|...+.+.....-.+. ....+++..++.++.|+..+..|..+...+.+.+.......+-++
T Consensus 65 fVV~GCy~g~lYfl~~~tGs~~w~f~~~~~vk~~-a~~d~~~glIycgshd~~~yalD~~~~~cVykskcgG~~f~sP~i 143 (354)
T KOG4649|consen 65 FVVLGCYSGGLYFLCVKTGSQIWNFVILETVKVR-AQCDFDGGLIYCGSHDGNFYALDPKTYGCVYKSKCGGGTFVSPVI 143 (354)
T ss_pred EEEEEEccCcEEEEEecchhheeeeeehhhhccc-eEEcCCCceEEEecCCCcEEEecccccceEEecccCCceecccee
Confidence 7999999999999999999888877641222222 234668999999999999999999998888877665554445555
Q ss_pred cc-CCCEE-EEecCc
Q 036605 124 LC-EEKIF-ALASSE 136 (340)
Q Consensus 124 ~~-~~~~l-~~~~~~ 136 (340)
.| ++.+. ++.++.
T Consensus 144 ~~g~~sly~a~t~G~ 158 (354)
T KOG4649|consen 144 APGDGSLYAAITAGA 158 (354)
T ss_pred cCCCceEEEEeccce
Confidence 55 34333 334444
No 333
>PF06433 Me-amine-dh_H: Methylamine dehydrogenase heavy chain (MADH); InterPro: IPR009451 Methylamine dehydrogenase (1.4.99.3 from EC) is a periplasmic quinoprotein found in several methyltrophic bacteria []. It is induced when grown on methylamine as a carbon source MADH and catalyses the oxidative deamination of amines to their corresponding aldehydes. The redox cofactor of this enzyme is tryptophan tryptophylquinone (TTQ). Electrons derived from the oxidation of methylamine are passed to an electron acceptor, which is usually the blue-copper protein amicyanin (IPR002386 from INTERPRO). RCH2NH2 + H2O + acceptor = RCHO + NH3 + reduced acceptor MADH is a hetero-tetramer, comprised of two heavy subunits and two light subunits. The heavy subunit forms a seven-bladed beta-propeller like structure [].; GO: 0030058 amine dehydrogenase activity, 0030416 methylamine metabolic process, 0055114 oxidation-reduction process, 0042597 periplasmic space; PDB: 3RN1_F 3SVW_F 3PXT_F 3L4O_F 3L4M_D 3SJL_F 3PXS_D 3ORV_F 3RMZ_F 3RLM_F ....
Probab=98.00 E-value=0.0018 Score=54.58 Aligned_cols=176 Identities=16% Similarity=0.146 Sum_probs=110.3
Q ss_pred CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeC----------CCcEEEEeCCCCeEEEEeecCCC-----
Q 036605 52 GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGT----------NGMASEMKSEMGEVIREFKASEK----- 116 (340)
Q Consensus 52 g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~----------dg~i~~wd~~~~~~~~~~~~~~~----- 116 (340)
+.++++|..+++.+..+.. +..-.+..+|+++.+++++. .-.|.+||..+-.+..++.-...
T Consensus 17 ~rv~viD~d~~k~lGmi~~---g~~~~~~~spdgk~~y~a~T~~sR~~rG~RtDvv~~~D~~TL~~~~EI~iP~k~R~~~ 93 (342)
T PF06433_consen 17 SRVYVIDADSGKLLGMIDT---GFLGNVALSPDGKTIYVAETFYSRGTRGERTDVVEIWDTQTLSPTGEIEIPPKPRAQV 93 (342)
T ss_dssp EEEEEEETTTTEEEEEEEE---ESSEEEEE-TTSSEEEEEEEEEEETTEEEEEEEEEEEETTTTEEEEEEEETTS-B--B
T ss_pred ceEEEEECCCCcEEEEeec---ccCCceeECCCCCEEEEEEEEEeccccccceeEEEEEecCcCcccceEecCCcchhee
Confidence 5799999999998877765 34445778999999887532 23689999999988776543322
Q ss_pred --CeeEEEEccCCCEEEEecCc----EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCC
Q 036605 117 --PISSSAFLCEEKIFALASSE----VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSK 190 (340)
Q Consensus 117 --~i~~l~~~~~~~~l~~~~~~----i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~ 190 (340)
....++++.|++++++..-+ |.|.|+..++.+..+... . +...+......+.+-+. ||.+.-..++. .+
T Consensus 94 ~~~~~~~~ls~dgk~~~V~N~TPa~SVtVVDl~~~kvv~ei~~P--G-C~~iyP~~~~~F~~lC~-DGsl~~v~Ld~-~G 168 (342)
T PF06433_consen 94 VPYKNMFALSADGKFLYVQNFTPATSVTVVDLAAKKVVGEIDTP--G-CWLIYPSGNRGFSMLCG-DGSLLTVTLDA-DG 168 (342)
T ss_dssp S--GGGEEE-TTSSEEEEEEESSSEEEEEEETTTTEEEEEEEGT--S-EEEEEEEETTEEEEEET-TSCEEEEEETS-TS
T ss_pred cccccceEEccCCcEEEEEccCCCCeEEEEECCCCceeeeecCC--C-EEEEEecCCCceEEEec-CCceEEEEECC-CC
Confidence 22457889999999875443 999999999888777531 1 22233222234666566 99999999863 33
Q ss_pred CccCCceeeecC---CCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCC
Q 036605 191 TVNKGPALSMRH---SPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVS 239 (340)
Q Consensus 191 ~~~~~~~~~~~~---~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~ 239 (340)
+..... ..+-+ .+.+..- .+ ...+..++..+..|.|+-.|+....
T Consensus 169 k~~~~~-t~~F~~~~dp~f~~~--~~-~~~~~~~~F~Sy~G~v~~~dlsg~~ 216 (342)
T PF06433_consen 169 KEAQKS-TKVFDPDDDPLFEHP--AY-SRDGGRLYFVSYEGNVYSADLSGDS 216 (342)
T ss_dssp SEEEEE-EEESSTTTS-B-S----EE-ETTTTEEEEEBTTSEEEEEEETTSS
T ss_pred CEeEee-ccccCCCCccccccc--ce-ECCCCeEEEEecCCEEEEEeccCCc
Confidence 322111 11111 1111111 11 2344566668899999998887643
No 334
>COG3490 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=98.00 E-value=0.0014 Score=53.14 Aligned_cols=212 Identities=13% Similarity=0.122 Sum_probs=121.4
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCC-----CcEEEEEccCC-eeEEEecCCCCC
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSN-----GDILAVDVLTG-EMKWKSTGRHPG 74 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~d-----g~i~i~d~~~~-~~~~~~~~~h~~ 74 (340)
|+|.+.++...........|-. ---.|||||+ +|++.-+| |.|-|||...+ +.+..+.. |.-
T Consensus 95 vfD~~~~~~pv~~~s~~~RHfy--GHGvfs~dG~---------~LYATEndfd~~rGViGvYd~r~~fqrvgE~~t-~Gi 162 (366)
T COG3490 95 VFDPNGAQEPVTLVSQEGRHFY--GHGVFSPDGR---------LLYATENDFDPNRGVIGVYDAREGFQRVGEFST-HGI 162 (366)
T ss_pred EECCCCCcCcEEEecccCceee--cccccCCCCc---------EEEeecCCCCCCCceEEEEecccccceeccccc-CCc
Confidence 3556655554443321111111 1235899999 77765544 78999998754 23445555 766
Q ss_pred CeEEEEEecCCCEEEEEeC------C------------CcEEEEeCCCCeEEEEe--e--cCCCCeeEEEEccCCCEEEE
Q 036605 75 GLAGLAFAKKGRSLHVVGT------N------------GMASEMKSEMGEVIREF--K--ASEKPISSSAFLCEEKIFAL 132 (340)
Q Consensus 75 ~v~~v~~~~~~~~l~s~~~------d------------g~i~~wd~~~~~~~~~~--~--~~~~~i~~l~~~~~~~~l~~ 132 (340)
.-..+.|.+||+.|+.+.. | .++.+.|..+|+.+.+. . .+...+..++..+||..++.
T Consensus 163 GpHev~lm~DGrtlvvanGGIethpdfgR~~lNldsMePSlvlld~atG~liekh~Lp~~l~~lSiRHld~g~dgtvwfg 242 (366)
T COG3490 163 GPHEVTLMADGRTLVVANGGIETHPDFGRTELNLDSMEPSLVLLDAATGNLIEKHTLPASLRQLSIRHLDIGRDGTVWFG 242 (366)
T ss_pred CcceeEEecCCcEEEEeCCceecccccCccccchhhcCccEEEEeccccchhhhccCchhhhhcceeeeeeCCCCcEEEE
Confidence 7788999999998887543 1 23555565666655442 2 23456788888899888765
Q ss_pred ec----Cc---EEEEECCCCceeEEeec-------CCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCcee
Q 036605 133 AS----SE---VRILSLENGEEVLKFSD-------DVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPAL 198 (340)
Q Consensus 133 ~~----~~---i~i~d~~~~~~~~~~~~-------~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~ 198 (340)
+. .+ -.+=-...++.+.-+.. ....|-+++.+.+...++.++-..+...+||. .++.......+
T Consensus 243 cQy~G~~~d~ppLvg~~~~g~~l~~~~~pee~~~~~anYigsiA~n~~~glV~lTSP~GN~~vi~da--~tG~vv~~a~l 320 (366)
T COG3490 243 CQYRGPRNDLPPLVGHFRKGEPLEFLDLPEEQTAAFANYIGSIAANRRDGLVALTSPRGNRAVIWDA--ATGAVVSEAAL 320 (366)
T ss_pred EEeeCCCccCCcceeeccCCCcCcccCCCHHHHHHHHhhhhheeecccCCeEEEecCCCCeEEEEEc--CCCcEEecccc
Confidence 32 21 11111233334333321 22567788887666666666665788899998 55544322221
Q ss_pred eecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECC
Q 036605 199 SMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLK 236 (340)
Q Consensus 199 ~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~ 236 (340)
.. ...+ .....-+++.+.+|.+.++.-.
T Consensus 321 --~d---aaGv-----a~~~~gf~vssg~G~~~~~s~~ 348 (366)
T COG3490 321 --PD---AAGV-----AAAKGGFAVSSGQGRIIFYSRA 348 (366)
T ss_pred --cc---cccc-----eeccCceEEecCCceEEecccc
Confidence 11 0111 2333346667788988888543
No 335
>PF08553 VID27: VID27 cytoplasmic protein; InterPro: IPR013863 This entry represents fungal and plant proteins and contains many hypothetical proteins. Vid27p is a cytoplasmic protein of unknown function, possibly regulates import of fructose-1,6-bisphosphatase into Vacuolar Import and Degradation (Vid) vesicles and is not essential for proteasome-dependent degradation of fructose-1,6-bisphosphatase (FBPase) [, ].
Probab=97.99 E-value=0.00045 Score=64.97 Aligned_cols=133 Identities=13% Similarity=0.114 Sum_probs=86.2
Q ss_pred ccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe--eEEE-e-cCCCCCCeE
Q 036605 2 WSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE--MKWK-S-TGRHPGGLA 77 (340)
Q Consensus 2 wd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~--~~~~-~-~~~h~~~v~ 77 (340)
.|+++|+++.+|.. +...+| ..+.|+.+-.. -...-.++|-.+..+..||.+-.. ++.. . .........
T Consensus 509 mDLe~GKVV~eW~~---~~~~~v--~~~~p~~K~aq--lt~e~tflGls~n~lfriDpR~~~~k~v~~~~k~Y~~~~~Fs 581 (794)
T PF08553_consen 509 MDLERGKVVEEWKV---HDDIPV--VDIAPDSKFAQ--LTNEQTFLGLSDNSLFRIDPRLSGNKLVDSQSKQYSSKNNFS 581 (794)
T ss_pred EecCCCcEEEEeec---CCCcce--eEecccccccc--cCCCceEEEECCCceEEeccCCCCCceeeccccccccCCCce
Confidence 37899999999992 233334 44555432000 001146778888899999987532 2211 1 111334567
Q ss_pred EEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE-ecCcEEEEEC
Q 036605 78 GLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL-ASSEVRILSL 142 (340)
Q Consensus 78 ~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~-~~~~i~i~d~ 142 (340)
|++-+.+| +|+.|+.+|.|++||--..+....+.+-..+|..|.++.||+++++ +..-|.+++.
T Consensus 582 ~~aTt~~G-~iavgs~~G~IRLyd~~g~~AKT~lp~lG~pI~~iDvt~DGkwilaTc~tyLlLi~t 646 (794)
T PF08553_consen 582 CFATTEDG-YIAVGSNKGDIRLYDRLGKRAKTALPGLGDPIIGIDVTADGKWILATCKTYLLLIDT 646 (794)
T ss_pred EEEecCCc-eEEEEeCCCcEEeecccchhhhhcCCCCCCCeeEEEecCCCcEEEEeecceEEEEEE
Confidence 77766544 7899999999999995433333346666789999999999999866 5444777775
No 336
>KOG4649 consensus PQQ (pyrrolo-quinoline quinone) repeat protein [Secondary metabolites biosynthesis, transport and catabolism]
Probab=97.98 E-value=0.0053 Score=49.20 Aligned_cols=129 Identities=17% Similarity=0.138 Sum_probs=90.8
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEE
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAF 123 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~ 123 (340)
+++.|+..+.+...|..+|+..+.-. -..+|-+-+.- -|..++.|...|.+++.+..+|.....+.....--.....
T Consensus 25 ~v~igSHs~~~~avd~~sG~~~We~i--lg~RiE~sa~v-vgdfVV~GCy~g~lYfl~~~tGs~~w~f~~~~~vk~~a~~ 101 (354)
T KOG4649|consen 25 LVVIGSHSGIVIAVDPQSGNLIWEAI--LGVRIECSAIV-VGDFVVLGCYSGGLYFLCVKTGSQIWNFVILETVKVRAQC 101 (354)
T ss_pred EEEEecCCceEEEecCCCCcEEeehh--hCceeeeeeEE-ECCEEEEEEccCcEEEEEecchhheeeeeehhhhccceEE
Confidence 88899999999999999999887654 33455444433 3778999999999999999999888887654433344556
Q ss_pred ccCCCEEEEecCc--EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEc
Q 036605 124 LCEEKIFALASSE--VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGY 175 (340)
Q Consensus 124 ~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~ 175 (340)
.+++..+..++.+ .+..|.++...+.+.+-..+.-.+.++.|-...|+.+..
T Consensus 102 d~~~glIycgshd~~~yalD~~~~~cVykskcgG~~f~sP~i~~g~~sly~a~t 155 (354)
T KOG4649|consen 102 DFDGGLIYCGSHDGNFYALDPKTYGCVYKSKCGGGTFVSPVIAPGDGSLYAAIT 155 (354)
T ss_pred cCCCceEEEecCCCcEEEecccccceEEecccCCceeccceecCCCceEEEEec
Confidence 7888888877665 888898888888775433333334455552223343344
No 337
>PF00930 DPPIV_N: Dipeptidyl peptidase IV (DPP IV) N-terminal region; InterPro: IPR002469 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This domain defines serine peptidases belonging to MEROPS peptidase family S9 (clan SC), subfamily S9B (dipeptidyl-peptidase IV). The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. This domain is an alignment of the region to the N-terminal side of the active site, which is found in IPR001375 from INTERPRO. CD26 (3.4.14.5 from EC) is also called adenosine deaminase-binding protein (ADA-binding protein) or dipeptidylpeptidase IV (DPP IV ectoenzyme). The exopeptidase cleaves off N-terminal X-Pro or X-Ala dipeptides from polypeptides (dipeptidyl peptidase IV activity). CD26 serves as the costimulatory molecule in T cell activation and is an associated marker of autoimmune diseases, adenosine deaminase-deficiency and HIV pathogenesis. Dipeptidyl peptidase IV (DPP IV) is responsible for the removal of N-terminal dipeptides sequentially from polypeptides having unsubstituted N termini, provided that the penultimate residue is proline. The enzyme catalyses the reaction: Dipeptidyl-Polypeptide + H(2)O = Dipeptide + Polypeptide It is a type II membrane protein that forms a homodimer. CD molecules are leucocyte antigens on cell surfaces. CD antigens nomenclature is updated at Protein Reviews On The Web (http://prow.nci.nih.gov/). ; GO: 0006508 proteolysis, 0016020 membrane; PDB: 2RIP_A 3Q8W_B 2AJL_I 1TKR_B 1TK3_B 3C45_A 2G5P_A 3G0C_D 1R9M_C 1RWQ_A ....
Probab=97.97 E-value=0.0015 Score=56.98 Aligned_cols=175 Identities=10% Similarity=0.086 Sum_probs=99.5
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCC--------
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRH-------- 72 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h-------- 72 (340)
|||+++++...... ....+....|||+|+ .+|... ++.|++++..++...+....+-
T Consensus 27 i~d~~~~~~~~l~~-----~~~~~~~~~~sP~g~---------~~~~v~-~~nly~~~~~~~~~~~lT~dg~~~i~nG~~ 91 (353)
T PF00930_consen 27 IYDIETGEITPLTP-----PPPKLQDAKWSPDGK---------YIAFVR-DNNLYLRDLATGQETQLTTDGEPGIYNGVP 91 (353)
T ss_dssp EEETTTTEEEESS------EETTBSEEEE-SSST---------EEEEEE-TTEEEEESSTTSEEEESES--TTTEEESB-
T ss_pred EEecCCCceEECcC-----CccccccceeecCCC---------eeEEEe-cCceEEEECCCCCeEEeccccceeEEcCcc
Confidence 46777776554333 146788899999998 676664 6789999988875443222210
Q ss_pred --------CCCeEEEEEecCCCEEEEEeCC-Cc-----------------------------------EEEEeCCCCeEE
Q 036605 73 --------PGGLAGLAFAKKGRSLHVVGTN-GM-----------------------------------ASEMKSEMGEVI 108 (340)
Q Consensus 73 --------~~~v~~v~~~~~~~~l~s~~~d-g~-----------------------------------i~~wd~~~~~~~ 108 (340)
-+.-..+-||||+++|+....| .. +.++|+.+++..
T Consensus 92 dwvyeEEv~~~~~~~~WSpd~~~la~~~~d~~~v~~~~~~~~~~~~~~yp~~~~~~YPk~G~~np~v~l~v~~~~~~~~~ 171 (353)
T PF00930_consen 92 DWVYEEEVFDRRSAVWWSPDSKYLAFLRFDEREVPEYPLPDYSPPDSQYPEVESIRYPKAGDPNPRVSLFVVDLASGKTT 171 (353)
T ss_dssp -HHHHHHTSSSSBSEEE-TTSSEEEEEEEE-TTS-EEEEEEESSSTESS-EEEEEE--BTTS---EEEEEEEESSSTCCC
T ss_pred ceeccccccccccceEECCCCCEEEEEEECCcCCceEEeeccCCccccCCcccccccCCCCCcCCceEEEEEECCCCcEE
Confidence 1223568899999998875433 22 223344333321
Q ss_pred E-Ee----ecCCCCeeEEEEccCCCEE-EE-ecCc-----EEEEECCCCceeEEee-cCCCC---eEEEEEC-CCCCEEE
Q 036605 109 R-EF----KASEKPISSSAFLCEEKIF-AL-ASSE-----VRILSLENGEEVLKFS-DDVGP---LQYVSAS-DGAKIII 171 (340)
Q Consensus 109 ~-~~----~~~~~~i~~l~~~~~~~~l-~~-~~~~-----i~i~d~~~~~~~~~~~-~~~~~---v~~~~~s-~~~~~l~ 171 (340)
. .. .....-+..+.|.+++..+ +. .++. +.++|..++.....+. ...+. -....|. +++..++
T Consensus 172 ~~~~~~~~~~~~~yl~~v~W~~d~~~l~~~~~nR~q~~~~l~~~d~~tg~~~~~~~e~~~~Wv~~~~~~~~~~~~~~~~l 251 (353)
T PF00930_consen 172 ELDPPNSLNPQDYYLTRVGWSPDGKRLWVQWLNRDQNRLDLVLCDASTGETRVVLEETSDGWVDVYDPPHFLGPDGNEFL 251 (353)
T ss_dssp EE---HHHHTSSEEEEEEEEEETTEEEEEEEEETTSTEEEEEEEEECTTTCEEEEEEESSSSSSSSSEEEE-TTTSSEEE
T ss_pred EeeeccccCCCccCcccceecCCCcEEEEEEcccCCCEEEEEEEECCCCceeEEEEecCCcceeeecccccccCCCCEEE
Confidence 1 11 1122346788899998844 33 3333 7788887775433221 12222 2355554 6666666
Q ss_pred EEEcCCCeEEEEEccCCCC
Q 036605 172 TAGYGEKHLQVWRCDISSK 190 (340)
Q Consensus 172 s~~~~d~~i~iwd~~~~~~ 190 (340)
..+..+|.-+||-++...+
T Consensus 252 ~~s~~~G~~hly~~~~~~~ 270 (353)
T PF00930_consen 252 WISERDGYRHLYLYDLDGG 270 (353)
T ss_dssp EEEETTSSEEEEEEETTSS
T ss_pred EEEEcCCCcEEEEEccccc
Confidence 6566788888877754444
No 338
>KOG1645 consensus RING-finger-containing E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=97.96 E-value=0.00013 Score=61.32 Aligned_cols=149 Identities=13% Similarity=0.134 Sum_probs=91.5
Q ss_pred EEEEEccCCeeEEEecCCCCCCeEEEEEecCCC-EEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE
Q 036605 54 ILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGR-SLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL 132 (340)
Q Consensus 54 i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~-~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~ 132 (340)
+++.+..+.+...-+.. |...|.+++|+|..+ ++..++.+..|.+.|+++...+..+..+ ..+++++|.-+....+-
T Consensus 175 v~~l~~~~fkssq~lp~-~g~~IrdlafSp~~~GLl~~asl~nkiki~dlet~~~vssy~a~-~~~wSC~wDlde~h~IY 252 (463)
T KOG1645|consen 175 VQKLESHDFKSSQILPG-EGSFIRDLAFSPFNEGLLGLASLGNKIKIMDLETSCVVSSYIAY-NQIWSCCWDLDERHVIY 252 (463)
T ss_pred eEEeccCCcchhhcccc-cchhhhhhccCccccceeeeeccCceEEEEecccceeeeheecc-CCceeeeeccCCcceeE
Confidence 34444333333333344 778899999999877 6788899999999999999988888877 78999999988765544
Q ss_pred -ecCc--EEEEECCCCcee-EEeec--CCCCeEEEEEC------CCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeee
Q 036605 133 -ASSE--VRILSLENGEEV-LKFSD--DVGPLQYVSAS------DGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSM 200 (340)
Q Consensus 133 -~~~~--i~i~d~~~~~~~-~~~~~--~~~~v~~~~~s------~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~ 200 (340)
|... |.+||++..+.. ..+.+ ...+|..++.- +.+..++.+.. -+..|.+. .........+.+
T Consensus 253 aGl~nG~VlvyD~R~~~~~~~e~~a~~t~~pv~~i~~~~~n~~f~~gglLv~~lt---~l~f~ei~--~s~~~~p~vlel 327 (463)
T KOG1645|consen 253 AGLQNGMVLVYDMRQPEGPLMELVANVTINPVHKIAPVQPNKIFTSGGLLVFALT---VLQFYEIV--FSAECLPCVLEL 327 (463)
T ss_pred EeccCceEEEEEccCCCchHhhhhhhhccCcceeecccCccccccccceEEeeeh---hhhhhhhh--ccccCCCccccc
Confidence 4433 999999876433 23322 22455554442 23434443322 45567762 222223333334
Q ss_pred cCCCeeeee
Q 036605 201 RHSPVAIDC 209 (340)
Q Consensus 201 ~~~~~~~~~ 209 (340)
+.+...+++
T Consensus 328 e~pG~cism 336 (463)
T KOG1645|consen 328 EPPGICISM 336 (463)
T ss_pred CCCcceeee
Confidence 444444444
No 339
>KOG4640 consensus Anaphase-promoting complex (APC), subunit 4 [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=97.93 E-value=7.5e-05 Score=66.38 Aligned_cols=94 Identities=18% Similarity=0.182 Sum_probs=76.8
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeE-EEEEecCCCEEEEEeCCCcEEE
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLA-GLAFAKKGRSLHVVGTNGMASE 99 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~-~v~~~~~~~~l~s~~~dg~i~~ 99 (340)
...+.-+.|+|.-. ++|.+..+|.|.++.+. -+.++.+.- |...++ +++|.|||+.|+.|-.||+|++
T Consensus 20 ~~~i~~~ewnP~~d---------LiA~~t~~gelli~R~n-~qRlwtip~-p~~~v~~sL~W~~DGkllaVg~kdG~I~L 88 (665)
T KOG4640|consen 20 PINIKRIEWNPKMD---------LIATRTEKGELLIHRLN-WQRLWTIPI-PGENVTASLCWRPDGKLLAVGFKDGTIRL 88 (665)
T ss_pred ccceEEEEEcCccc---------hhheeccCCcEEEEEec-cceeEeccC-CCCccceeeeecCCCCEEEEEecCCeEEE
Confidence 35677899999888 99999999999999887 556888876 666676 9999999999999999999999
Q ss_pred EeCCCCeEEEEee-cCCCCeeEEEEcc
Q 036605 100 MKSEMGEVIREFK-ASEKPISSSAFLC 125 (340)
Q Consensus 100 wd~~~~~~~~~~~-~~~~~i~~l~~~~ 125 (340)
.|+.++..+..+. .-...|.++-|.+
T Consensus 89 ~Dve~~~~l~~~~~s~e~~is~~~w~~ 115 (665)
T KOG4640|consen 89 HDVEKGGRLVSFLFSVETDISKGIWDR 115 (665)
T ss_pred EEccCCCceeccccccccchheeeccc
Confidence 9999998776632 2344667776763
No 340
>KOG3617 consensus WD40 and TPR repeat-containing protein [General function prediction only]
Probab=97.88 E-value=0.00034 Score=64.52 Aligned_cols=71 Identities=20% Similarity=0.199 Sum_probs=61.5
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeC
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKS 102 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~ 102 (340)
.+++++|+|..- .|+.|-.-|.+.+|...+.+.. +....|+.+|..+.|+++|..|+++..-|.|.+|..
T Consensus 61 hatSLCWHpe~~---------vLa~gwe~g~~~v~~~~~~e~h-tv~~th~a~i~~l~wS~~G~~l~t~d~~g~v~lwr~ 130 (1416)
T KOG3617|consen 61 HATSLCWHPEEF---------VLAQGWEMGVSDVQKTNTTETH-TVVETHPAPIQGLDWSHDGTVLMTLDNPGSVHLWRY 130 (1416)
T ss_pred ehhhhccChHHH---------HHhhccccceeEEEecCCceee-eeccCCCCCceeEEecCCCCeEEEcCCCceeEEEEe
Confidence 357799999887 8999999999999998776644 444459999999999999999999999999999976
Q ss_pred C
Q 036605 103 E 103 (340)
Q Consensus 103 ~ 103 (340)
.
T Consensus 131 d 131 (1416)
T KOG3617|consen 131 D 131 (1416)
T ss_pred e
Confidence 5
No 341
>COG3386 Gluconolactonase [Carbohydrate transport and metabolism]
Probab=97.84 E-value=0.0097 Score=50.37 Aligned_cols=137 Identities=18% Similarity=0.176 Sum_probs=88.9
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeec-----CCCCe
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKA-----SEKPI 118 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~-----~~~~i 118 (340)
++.+--..+.|+-|+..+++. ..+. +.+.+.++..-..+..|+++.. -+.+++.+++..+..+.. .....
T Consensus 39 L~w~DI~~~~i~r~~~~~g~~-~~~~--~p~~~~~~~~~d~~g~Lv~~~~--g~~~~~~~~~~~~t~~~~~~~~~~~~r~ 113 (307)
T COG3386 39 LLWVDILGGRIHRLDPETGKK-RVFP--SPGGFSSGALIDAGGRLIACEH--GVRLLDPDTGGKITLLAEPEDGLPLNRP 113 (307)
T ss_pred EEEEeCCCCeEEEecCCcCce-EEEE--CCCCcccceeecCCCeEEEEcc--ccEEEeccCCceeEEeccccCCCCcCCC
Confidence 666777788999999887752 2333 3445555555555666666543 355666665555333221 12345
Q ss_pred eEEEEccCCCEEEEecC-----c--------EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 119 SSSAFLCEEKIFALASS-----E--------VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 119 ~~l~~~~~~~~l~~~~~-----~--------i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
+.+.+.|+|.+.++.-. . ++.+|. .+..++.+..+-..-+.++||||++.++.+-...+.|.-|++
T Consensus 114 ND~~v~pdG~~wfgt~~~~~~~~~~~~~~G~lyr~~p-~g~~~~l~~~~~~~~NGla~SpDg~tly~aDT~~~~i~r~~~ 192 (307)
T COG3386 114 NDGVVDPDGRIWFGDMGYFDLGKSEERPTGSLYRVDP-DGGVVRLLDDDLTIPNGLAFSPDGKTLYVADTPANRIHRYDL 192 (307)
T ss_pred CceeEcCCCCEEEeCCCccccCccccCCcceEEEEcC-CCCEEEeecCcEEecCceEECCCCCEEEEEeCCCCeEEEEec
Confidence 67889999998877333 1 555554 455666666666667899999999988887775688888887
Q ss_pred c
Q 036605 186 D 186 (340)
Q Consensus 186 ~ 186 (340)
+
T Consensus 193 d 193 (307)
T COG3386 193 D 193 (307)
T ss_pred C
Confidence 4
No 342
>cd00216 PQQ_DH Dehydrogenases with pyrrolo-quinoline quinone (PQQ) as cofactor, like ethanol, methanol, and membrane bound glucose dehydrogenases. The alignment model contains an 8-bladed beta-propeller.
Probab=97.83 E-value=0.0037 Score=57.07 Aligned_cols=190 Identities=15% Similarity=0.246 Sum_probs=109.2
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCC-----CCe--EEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCC
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHP-----GGL--AGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEK 116 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~-----~~v--~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~ 116 (340)
.+++++.++.|+.+|..+|+.++++..... ..+ ..++.. ++..++.++.++.|..+|..+|+.+.++.....
T Consensus 63 ~vy~~~~~g~l~AlD~~tG~~~W~~~~~~~~~~~~~~~~~~g~~~~-~~~~V~v~~~~g~v~AlD~~TG~~~W~~~~~~~ 141 (488)
T cd00216 63 DMYFTTSHSALFALDAATGKVLWRYDPKLPADRGCCDVVNRGVAYW-DPRKVFFGTFDGRLVALDAETGKQVWKFGNNDQ 141 (488)
T ss_pred EEEEeCCCCcEEEEECCCChhhceeCCCCCccccccccccCCcEEc-cCCeEEEecCCCeEEEEECCCCCEeeeecCCCC
Confidence 477788899999999999999988764111 011 111111 226788888999999999999999887654332
Q ss_pred C-----e-eEEEEccCCCEEEEe----------cCcEEEEECCCCceeEEeecCCC--------------------Ce-E
Q 036605 117 P-----I-SSSAFLCEEKIFALA----------SSEVRILSLENGEEVLKFSDDVG--------------------PL-Q 159 (340)
Q Consensus 117 ~-----i-~~l~~~~~~~~l~~~----------~~~i~i~d~~~~~~~~~~~~~~~--------------------~v-~ 159 (340)
. + ....+. ++.+++.. ++.+..+|..+|+.+-.+..... .+ .
T Consensus 142 ~~~~~~i~ssP~v~-~~~v~vg~~~~~~~~~~~~g~v~alD~~TG~~~W~~~~~~~~~~~~~~~~~~~~~~~~~g~~vw~ 220 (488)
T cd00216 142 VPPGYTMTGAPTIV-KKLVIIGSSGAEFFACGVRGALRAYDVETGKLLWRFYTTEPDPNAFPTWGPDRQMWGPGGGTSWA 220 (488)
T ss_pred cCcceEecCCCEEE-CCEEEEeccccccccCCCCcEEEEEECCCCceeeEeeccCCCcCCCCCCCCCcceecCCCCCccC
Confidence 1 1 122222 23333321 23488999999988766543211 01 1
Q ss_pred EEEECCCCCEEEEEEcCCC------------------eEEEEEccCCCCCccCCceeee--------cCCCeeeeeecCC
Q 036605 160 YVSASDGAKIIITAGYGEK------------------HLQVWRCDISSKTVNKGPALSM--------RHSPVAIDCKNSP 213 (340)
Q Consensus 160 ~~~~s~~~~~l~s~~~~d~------------------~i~iwd~~~~~~~~~~~~~~~~--------~~~~~~~~~~~~~ 213 (340)
..++.+.+..++.+.. ++ .|.-+|. .+++..-...... ...+.+... .
T Consensus 221 ~pa~d~~~g~V~vg~~-~g~~~~~~~~~~~~~~~~~~~l~Ald~--~tG~~~W~~~~~~~~~~~~~~~s~p~~~~~--~- 294 (488)
T cd00216 221 SPTYDPKTNLVYVGTG-NGSPWNWGGRRTPGDNLYTDSIVALDA--DTGKVKWFYQTTPHDLWDYDGPNQPSLADI--K- 294 (488)
T ss_pred CeeEeCCCCEEEEECC-CCCCCccCCccCCCCCCceeeEEEEcC--CCCCEEEEeeCCCCCCcccccCCCCeEEec--c-
Confidence 2344444555666543 43 5666665 5554432221100 001111111 0
Q ss_pred CCCCC---CEEEEEeCCCcEEEEECCCCCccC
Q 036605 214 NGEDG---TVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 214 ~~~~~---~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
.-++ ..+++++.+|.++.+|..+++.+-
T Consensus 295 -~~~g~~~~~V~~g~~~G~l~ald~~tG~~~W 325 (488)
T cd00216 295 -PKDGKPVPAIVHAPKNGFFYVLDRTTGKLIS 325 (488)
T ss_pred -ccCCCeeEEEEEECCCceEEEEECCCCcEee
Confidence 0122 267888899999999999987765
No 343
>PF02897 Peptidase_S9_N: Prolyl oligopeptidase, N-terminal beta-propeller domain; InterPro: IPR004106 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This entry represents the beta-propeller domain found at the N-terminal of prolyl oligopeptidase, including acylamino-acid-releasing enzyme (also known as acylaminoacyl peptidase), which belong to the MEROPS peptidase family S9 (clan SC), subfamily S9A. The prolyl oligopeptidase family consist of a number of evolutionary related peptidases whose catalytic activity seems to be provided by a charge relay system similar to that of the trypsin family of serine proteases, but which evolved by independent convergent evolution. The N-terminal domain of prolyl oligopeptidases form an unusual 7-bladed beta-propeller consisting of seven 4-stranded beta-sheet motifs. Prolyl oligopeptidase is a large cytosolic enzyme involved in the maturation and degradation of peptide hormones and neuropeptides, which relate to the induction of amnesia. The enzyme contains a peptidase domain, where its catalytic triad (Ser554, His680, Asp641) is covered by the central tunnel of the N-terminal beta-propeller domain. In this way, large structured peptides are excluded from the active site, thereby protecting larger peptides and proteins from proteolysis in the cytosol []. The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. Mammalian acylaminoacyl peptidase is an exopeptidase that is a member of the same prolyl oligopeptidase family of serine peptidases. This enzyme removes acylated amino acid residues from the N terminus of oligopeptides [].; GO: 0004252 serine-type endopeptidase activity, 0006508 proteolysis; PDB: 2BKL_B 3DDU_A 1YR2_A 2XE4_A 1VZ3_A 3EQ9_A 1O6F_A 3EQ7_A 4AN0_A 1UOP_A ....
Probab=97.80 E-value=0.0079 Score=53.82 Aligned_cols=193 Identities=17% Similarity=0.221 Sum_probs=102.0
Q ss_pred eEEEEeeccccccccccCceEEEEE-cCCC----cEEEEEccCCeeEEEe-cCCCCCCeEEEEEecCCCEEEEEeCCC--
Q 036605 24 YSCLACGFVGKKRRKERGTLLLALG-TSNG----DILAVDVLTGEMKWKS-TGRHPGGLAGLAFAKKGRSLHVVGTNG-- 95 (340)
Q Consensus 24 v~~l~~sp~~~~~~~~~~~~~l~~g-~~dg----~i~i~d~~~~~~~~~~-~~~h~~~v~~v~~~~~~~~l~s~~~dg-- 95 (340)
+....+||+++ ++|.+ +..| .|+++|+++|+.+... .. .....+.|.++++.|+....+.
T Consensus 126 ~~~~~~Spdg~---------~la~~~s~~G~e~~~l~v~Dl~tg~~l~d~i~~---~~~~~~~W~~d~~~~~y~~~~~~~ 193 (414)
T PF02897_consen 126 LGGFSVSPDGK---------RLAYSLSDGGSEWYTLRVFDLETGKFLPDGIEN---PKFSSVSWSDDGKGFFYTRFDEDQ 193 (414)
T ss_dssp EEEEEETTTSS---------EEEEEEEETTSSEEEEEEEETTTTEEEEEEEEE---EESEEEEECTTSSEEEEEECSTTT
T ss_pred eeeeeECCCCC---------EEEEEecCCCCceEEEEEEECCCCcCcCCcccc---cccceEEEeCCCCEEEEEEeCccc
Confidence 34578899998 67754 3334 5999999999865432 22 1122499999988776665432
Q ss_pred ---------cEEEEeCCCCeE--EEEeecCCCC--eeEEEEccCCCEEEE-----ec-CcEEEEECCCC----ceeEEee
Q 036605 96 ---------MASEMKSEMGEV--IREFKASEKP--ISSSAFLCEEKIFAL-----AS-SEVRILSLENG----EEVLKFS 152 (340)
Q Consensus 96 ---------~i~~wd~~~~~~--~~~~~~~~~~--i~~l~~~~~~~~l~~-----~~-~~i~i~d~~~~----~~~~~~~ 152 (340)
.|+.|.+.+... ...+...... ...+..++|+++++. .+ ..+++.|+..+ .....+.
T Consensus 194 ~~~~~~~~~~v~~~~~gt~~~~d~lvfe~~~~~~~~~~~~~s~d~~~l~i~~~~~~~~s~v~~~d~~~~~~~~~~~~~l~ 273 (414)
T PF02897_consen 194 RTSDSGYPRQVYRHKLGTPQSEDELVFEEPDEPFWFVSVSRSKDGRYLFISSSSGTSESEVYLLDLDDGGSPDAKPKLLS 273 (414)
T ss_dssp SS-CCGCCEEEEEEETTS-GGG-EEEEC-TTCTTSEEEEEE-TTSSEEEEEEESSSSEEEEEEEECCCTTTSS-SEEEEE
T ss_pred ccccCCCCcEEEEEECCCChHhCeeEEeecCCCcEEEEEEecCcccEEEEEEEccccCCeEEEEeccccCCCcCCcEEEe
Confidence 378888776542 2344443333 467889999999865 12 23899999875 2334443
Q ss_pred cCCCCeE-EEEECCCCCEEEEEEcC--CCeEEEEEccCCCCCccCCceeeecCCC--eeeeeecCCCCC-CCCEEEEEeC
Q 036605 153 DDVGPLQ-YVSASDGAKIIITAGYG--EKHLQVWRCDISSKTVNKGPALSMRHSP--VAIDCKNSPNGE-DGTVILAVAE 226 (340)
Q Consensus 153 ~~~~~v~-~~~~s~~~~~l~s~~~~--d~~i~iwd~~~~~~~~~~~~~~~~~~~~--~~~~~~~~~~~~-~~~~l~~~s~ 226 (340)
.....+. .+... .+.+++.+..+ .+.|.-.++ ...........-+.+.. .+..+ .. .+.+++....
T Consensus 274 ~~~~~~~~~v~~~-~~~~yi~Tn~~a~~~~l~~~~l--~~~~~~~~~~~l~~~~~~~~l~~~-----~~~~~~Lvl~~~~ 345 (414)
T PF02897_consen 274 PREDGVEYYVDHH-GDRLYILTNDDAPNGRLVAVDL--ADPSPAEWWTVLIPEDEDVSLEDV-----SLFKDYLVLSYRE 345 (414)
T ss_dssp ESSSS-EEEEEEE-TTEEEEEE-TT-TT-EEEEEET--TSTSGGGEEEEEE--SSSEEEEEE-----EEETTEEEEEEEE
T ss_pred CCCCceEEEEEcc-CCEEEEeeCCCCCCcEEEEecc--cccccccceeEEcCCCCceeEEEE-----EEECCEEEEEEEE
Confidence 3333333 33333 44444443332 345555555 33322111112223332 23333 22 2334444444
Q ss_pred CC--cEEEEECC
Q 036605 227 SG--VAYSWDLK 236 (340)
Q Consensus 227 dg--~i~vwd~~ 236 (340)
++ .|+++++.
T Consensus 346 ~~~~~l~v~~~~ 357 (414)
T PF02897_consen 346 NGSSRLRVYDLD 357 (414)
T ss_dssp TTEEEEEEEETT
T ss_pred CCccEEEEEECC
Confidence 54 47888888
No 344
>COG3386 Gluconolactonase [Carbohydrate transport and metabolism]
Probab=97.78 E-value=0.0051 Score=52.04 Aligned_cols=142 Identities=13% Similarity=0.080 Sum_probs=91.5
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcC-----------CCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEE
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTS-----------NGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHV 90 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~-----------dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s 90 (340)
...+.+...|+|+ +.+.... -|.|+.+|. .+.....+.. +-..-+.|+||||++.|+.
T Consensus 111 ~r~ND~~v~pdG~---------~wfgt~~~~~~~~~~~~~~G~lyr~~p-~g~~~~l~~~-~~~~~NGla~SpDg~tly~ 179 (307)
T COG3386 111 NRPNDGVVDPDGR---------IWFGDMGYFDLGKSEERPTGSLYRVDP-DGGVVRLLDD-DLTIPNGLAFSPDGKTLYV 179 (307)
T ss_pred CCCCceeEcCCCC---------EEEeCCCccccCccccCCcceEEEEcC-CCCEEEeecC-cEEecCceEECCCCCEEEE
Confidence 4455667778877 3333222 144555554 4555555554 5556689999999999988
Q ss_pred EeCC-CcEEEEeCCC--Ce-----EEEEeecCCCCeeEEEEccCCCEEEE--ec-CcEEEEECCCCceeEEeecCCCCeE
Q 036605 91 VGTN-GMASEMKSEM--GE-----VIREFKASEKPISSSAFLCEEKIFAL--AS-SEVRILSLENGEEVLKFSDDVGPLQ 159 (340)
Q Consensus 91 ~~~d-g~i~~wd~~~--~~-----~~~~~~~~~~~i~~l~~~~~~~~l~~--~~-~~i~i~d~~~~~~~~~~~~~~~~v~ 159 (340)
+... +.|..|++.. +. ....+.......-.+++..+|.+.++ .+ ..|.+|+.. ++.+..+......++
T Consensus 180 aDT~~~~i~r~~~d~~~g~~~~~~~~~~~~~~~G~PDG~~vDadG~lw~~a~~~g~~v~~~~pd-G~l~~~i~lP~~~~t 258 (307)
T COG3386 180 ADTPANRIHRYDLDPATGPIGGRRGFVDFDEEPGLPDGMAVDADGNLWVAAVWGGGRVVRFNPD-GKLLGEIKLPVKRPT 258 (307)
T ss_pred EeCCCCeEEEEecCcccCccCCcceEEEccCCCCCCCceEEeCCCCEEEecccCCceEEEECCC-CcEEEEEECCCCCCc
Confidence 8665 7888887652 11 11223334455667888888888744 22 269999988 888888877767788
Q ss_pred EEEE-CCCCCEEEEEEc
Q 036605 160 YVSA-SDGAKIIITAGY 175 (340)
Q Consensus 160 ~~~~-s~~~~~l~s~~~ 175 (340)
+++| .++.+.|+.++.
T Consensus 259 ~~~FgG~~~~~L~iTs~ 275 (307)
T COG3386 259 NPAFGGPDLNTLYITSA 275 (307)
T ss_pred cceEeCCCcCEEEEEec
Confidence 8888 455555555444
No 345
>PRK13616 lipoprotein LpqB; Provisional
Probab=97.76 E-value=0.0063 Score=56.44 Aligned_cols=147 Identities=13% Similarity=0.132 Sum_probs=85.6
Q ss_pred CCeEEEEeeccccccccccCceEEEEEc------CC--CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeC
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGT------SN--GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGT 93 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~------~d--g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~ 93 (340)
..+...+.||+|+ .+|... .| ..|.+++. .+.. ..+.. ....+...|+|+|..|++...
T Consensus 350 ~~vsspaiSpdG~---------~vA~v~~~~~~~~d~~s~Lwv~~~-gg~~-~~lt~--g~~~t~PsWspDG~~lw~v~d 416 (591)
T PRK13616 350 GNITSAALSRSGR---------QVAAVVTLGRGAPDPASSLWVGPL-GGVA-VQVLE--GHSLTRPSWSLDADAVWVVVD 416 (591)
T ss_pred cCcccceECCCCC---------EEEEEEeecCCCCCcceEEEEEeC-CCcc-eeeec--CCCCCCceECCCCCceEEEec
Confidence 4677889999997 455443 23 35666664 2322 33332 124788999999888877653
Q ss_pred C------------CcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE-ecCcEEE---EECCCCce-e---EEeec
Q 036605 94 N------------GMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL-ASSEVRI---LSLENGEE-V---LKFSD 153 (340)
Q Consensus 94 d------------g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~-~~~~i~i---~d~~~~~~-~---~~~~~ 153 (340)
. +.+.+.++..+.... .....|..+.|||||..++. .++.|++ -....|.. + ..+..
T Consensus 417 g~~~~~v~~~~~~gql~~~~vd~ge~~~---~~~g~Issl~wSpDG~RiA~i~~g~v~Va~Vvr~~~G~~~l~~~~~l~~ 493 (591)
T PRK13616 417 GNTVVRVIRDPATGQLARTPVDASAVAS---RVPGPISELQLSRDGVRAAMIIGGKVYLAVVEQTEDGQYALTNPREVGP 493 (591)
T ss_pred CcceEEEeccCCCceEEEEeccCchhhh---ccCCCcCeEEECCCCCEEEEEECCEEEEEEEEeCCCCceeecccEEeec
Confidence 3 233333443333222 22457999999999998865 5566655 44444531 1 12222
Q ss_pred -CCCCeEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 154 -DVGPLQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 154 -~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
-...+.++.|.+++..+ .+.. ++...+|.+.
T Consensus 494 ~l~~~~~~l~W~~~~~L~-V~~~-~~~~~v~~v~ 525 (591)
T PRK13616 494 GLGDTAVSLDWRTGDSLV-VGRS-DPEHPVWYVN 525 (591)
T ss_pred ccCCccccceEecCCEEE-EEec-CCCCceEEEe
Confidence 22335889999999755 4344 4444566654
No 346
>COG3204 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=97.76 E-value=0.012 Score=48.13 Aligned_cols=158 Identities=9% Similarity=0.003 Sum_probs=102.7
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
+....++++.|+|+.+ .|++..+...-.++=..+|+.+.++.-..-...-.+.+..++++.++--.+..+.
T Consensus 83 g~~~nvS~LTynp~~r---------tLFav~n~p~~iVElt~~GdlirtiPL~g~~DpE~Ieyig~n~fvi~dER~~~l~ 153 (316)
T COG3204 83 GETANVSSLTYNPDTR---------TLFAVTNKPAAIVELTKEGDLIRTIPLTGFSDPETIEYIGGNQFVIVDERDRALY 153 (316)
T ss_pred cccccccceeeCCCcc---------eEEEecCCCceEEEEecCCceEEEecccccCChhHeEEecCCEEEEEehhcceEE
Confidence 4556699999999998 7888888888888877788888876532223345677777777777766778887
Q ss_pred EEeCCCCeEEEE-----e-----ecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeE--Ee-ecC-------CC
Q 036605 99 EMKSEMGEVIRE-----F-----KASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVL--KF-SDD-------VG 156 (340)
Q Consensus 99 ~wd~~~~~~~~~-----~-----~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~--~~-~~~-------~~ 156 (340)
++.+..+..+.. + .........++|.|....|..+-.. +.||....+.... .. ..+ -.
T Consensus 154 ~~~vd~~t~~~~~~~~~i~L~~~~k~N~GfEGlA~d~~~~~l~~aKEr~P~~I~~~~~~~~~l~~~~~~~~~~~~~~f~~ 233 (316)
T COG3204 154 LFTVDADTTVISAKVQKIPLGTTNKKNKGFEGLAWDPVDHRLFVAKERNPIGIFEVTQSPSSLSVHASLDPTADRDLFVL 233 (316)
T ss_pred EEEEcCCccEEeccceEEeccccCCCCcCceeeecCCCCceEEEEEccCCcEEEEEecCCcccccccccCcccccceEee
Confidence 776655432211 1 1124567899999998888775544 5555544332111 10 111 14
Q ss_pred CeEEEEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 157 PLQYVSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 157 ~v~~~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
.+.++.|.+....+++-+..++.+.-.|.
T Consensus 234 DvSgl~~~~~~~~LLVLS~ESr~l~Evd~ 262 (316)
T COG3204 234 DVSGLEFNAITNSLLVLSDESRRLLEVDL 262 (316)
T ss_pred ccccceecCCCCcEEEEecCCceEEEEec
Confidence 57778888765555555665788877776
No 347
>PF03178 CPSF_A: CPSF A subunit region; InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=97.76 E-value=0.0018 Score=55.80 Aligned_cols=177 Identities=13% Similarity=0.067 Sum_probs=99.9
Q ss_pred CcEEEEEccCCeeEEEecCCCCCCeEEEE---EecC----CCEEEEEeC----------CCcEEEEeCCCC----eEEEE
Q 036605 52 GDILAVDVLTGEMKWKSTGRHPGGLAGLA---FAKK----GRSLHVVGT----------NGMASEMKSEMG----EVIRE 110 (340)
Q Consensus 52 g~i~i~d~~~~~~~~~~~~~h~~~v~~v~---~~~~----~~~l~s~~~----------dg~i~~wd~~~~----~~~~~ 110 (340)
+.|+++|..+.+.+..+.-.....+.+++ +..+ ..+++.|.. .|.|.++++... ..+..
T Consensus 2 s~i~l~d~~~~~~~~~~~l~~~E~~~s~~~~~l~~~~~~~~~~ivVGT~~~~~~~~~~~~Gri~v~~i~~~~~~~~~l~~ 81 (321)
T PF03178_consen 2 SSIRLVDPTTFEVLDSFELEPNEHVTSLCSVKLKGDSTGKKEYIVVGTAFNYGEDPEPSSGRILVFEISESPENNFKLKL 81 (321)
T ss_dssp -EEEEEETTTSSEEEEEEEETTEEEEEEEEEEETTS---SSEEEEEEEEE--TTSSS-S-EEEEEEEECSS-----EEEE
T ss_pred cEEEEEeCCCCeEEEEEECCCCceEEEEEEEEEcCccccccCEEEEEecccccccccccCcEEEEEEEEcccccceEEEE
Confidence 35778887777665554321233444444 3322 346666543 288999999884 12221
Q ss_pred e--ecCCCCeeEEEEccCCCEEEEecCcEEEEECCCCc-eeEE-eecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 111 F--KASEKPISSSAFLCEEKIFALASSEVRILSLENGE-EVLK-FSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 111 ~--~~~~~~i~~l~~~~~~~~l~~~~~~i~i~d~~~~~-~~~~-~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
+ ....++|++++-- .+.++++.+..|.+|++...+ .... +......+.++... +.+++.+.. ...+.++.++
T Consensus 82 i~~~~~~g~V~ai~~~-~~~lv~~~g~~l~v~~l~~~~~l~~~~~~~~~~~i~sl~~~--~~~I~vgD~-~~sv~~~~~~ 157 (321)
T PF03178_consen 82 IHSTEVKGPVTAICSF-NGRLVVAVGNKLYVYDLDNSKTLLKKAFYDSPFYITSLSVF--KNYILVGDA-MKSVSLLRYD 157 (321)
T ss_dssp EEEEEESS-EEEEEEE-TTEEEEEETTEEEEEEEETTSSEEEEEEE-BSSSEEEEEEE--TTEEEEEES-SSSEEEEEEE
T ss_pred EEEEeecCcceEhhhh-CCEEEEeecCEEEEEEccCcccchhhheecceEEEEEEecc--ccEEEEEEc-ccCEEEEEEE
Confidence 1 2346788988876 556667778889999998877 3322 22223355555554 558888666 7888888764
Q ss_pred CCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 187 ISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 187 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
. .......+.- -..+.++.++ .+ -.++..++++..+|.+.++....
T Consensus 158 ~-~~~~l~~va~-d~~~~~v~~~--~~-l~d~~~~i~~D~~gnl~~l~~~~ 203 (321)
T PF03178_consen 158 E-ENNKLILVAR-DYQPRWVTAA--EF-LVDEDTIIVGDKDGNLFVLRYNP 203 (321)
T ss_dssp T-TTE-EEEEEE-ESS-BEEEEE--EE-E-SSSEEEEEETTSEEEEEEE-S
T ss_pred c-cCCEEEEEEe-cCCCccEEEE--EE-ecCCcEEEEEcCCCeEEEEEECC
Confidence 2 1111111111 1122233333 33 22335899999999999998864
No 348
>KOG2114 consensus Vacuolar assembly/sorting protein PEP5/VPS11 [Intracellular trafficking, secretion, and vesicular transport]
Probab=97.75 E-value=0.0074 Score=56.15 Aligned_cols=140 Identities=19% Similarity=0.204 Sum_probs=96.2
Q ss_pred EEEEEcCCC-----cEEEEEccCC------eeE--EEecC----CCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCC--
Q 036605 44 LLALGTSNG-----DILAVDVLTG------EMK--WKSTG----RHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEM-- 104 (340)
Q Consensus 44 ~l~~g~~dg-----~i~i~d~~~~------~~~--~~~~~----~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~-- 104 (340)
+|++-+.|+ .|+||+++.- .+. +++.. ..+.++.+++.+.+-+.++.|-.+|.|..+.-.-
T Consensus 79 ~L~sv~Ed~~~np~llkiw~lek~~~n~sP~c~~~~ri~~~~np~~~~p~s~l~Vs~~l~~Iv~Gf~nG~V~~~~GDi~R 158 (933)
T KOG2114|consen 79 FLFSVGEDEQGNPVLLKIWDLEKVDKNNSPQCLYEHRIFTIKNPTNPSPASSLAVSEDLKTIVCGFTNGLVICYKGDILR 158 (933)
T ss_pred EEEEEeecCCCCceEEEEecccccCCCCCcceeeeeeeeccCCCCCCCcceEEEEEccccEEEEEecCcEEEEEcCcchh
Confidence 677666554 5899998643 122 12211 1356788999999888899999999999885221
Q ss_pred --CeEEEEeecCCCCeeEEEEccCCCE--EEEecCcEEEEECCCCce-eEEeecCCCCeEEEEECCCCCEEEEEEcCCCe
Q 036605 105 --GEVIREFKASEKPISSSAFLCEEKI--FALASSEVRILSLENGEE-VLKFSDDVGPLQYVSASDGAKIIITAGYGEKH 179 (340)
Q Consensus 105 --~~~~~~~~~~~~~i~~l~~~~~~~~--l~~~~~~i~i~d~~~~~~-~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~ 179 (340)
|...........+|+.+++..++.. +++....|.+|.+....+ ...+..|..+..+..|++....+++++ +..
T Consensus 159 Drgsr~~~~~~~~~pITgL~~~~d~~s~lFv~Tt~~V~~y~l~gr~p~~~~ld~~G~~lnCss~~~~t~qfIca~--~e~ 236 (933)
T KOG2114|consen 159 DRGSRQDYSHRGKEPITGLALRSDGKSVLFVATTEQVMLYSLSGRTPSLKVLDNNGISLNCSSFSDGTYQFICAG--SEF 236 (933)
T ss_pred ccccceeeeccCCCCceeeEEecCCceeEEEEecceeEEEEecCCCcceeeeccCCccceeeecCCCCccEEEec--Cce
Confidence 1112223345679999999999887 455666699999985442 344677778889999987766466644 478
Q ss_pred EEEEEc
Q 036605 180 LQVWRC 185 (340)
Q Consensus 180 i~iwd~ 185 (340)
+.+|+.
T Consensus 237 l~fY~s 242 (933)
T KOG2114|consen 237 LYFYDS 242 (933)
T ss_pred EEEEcC
Confidence 999996
No 349
>KOG3621 consensus WD40 repeat-containing protein [General function prediction only]
Probab=97.75 E-value=0.0049 Score=55.99 Aligned_cols=75 Identities=16% Similarity=0.130 Sum_probs=59.1
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe-----eEEEecCCCCCCeEEEEEecCCCEEEEEeCCC
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE-----MKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNG 95 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~-----~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg 95 (340)
...+..+..|++.. ++|+|+..|.|.++.+..+. ....+...|...|++++|++++..+|+|...|
T Consensus 76 ~~~~~~~~vs~~e~---------lvAagt~~g~V~v~ql~~~~p~~~~~~t~~d~~~~~rVTal~Ws~~~~k~ysGD~~G 146 (726)
T KOG3621|consen 76 TGITCVRSVSSVEY---------LVAAGTASGRVSVFQLNKELPRDLDYVTPCDKSHKCRVTALEWSKNGMKLYSGDSQG 146 (726)
T ss_pred cceEEEEEecchhH---------hhhhhcCCceEEeehhhccCCCcceeeccccccCCceEEEEEecccccEEeecCCCc
Confidence 34455566788888 89999999999999877643 22233335788999999999999999999999
Q ss_pred cEEEEeCCC
Q 036605 96 MASEMKSEM 104 (340)
Q Consensus 96 ~i~~wd~~~ 104 (340)
.|..-.+.+
T Consensus 147 kv~~~~L~s 155 (726)
T KOG3621|consen 147 KVVLTELDS 155 (726)
T ss_pred eEEEEEech
Confidence 998877665
No 350
>cd00216 PQQ_DH Dehydrogenases with pyrrolo-quinoline quinone (PQQ) as cofactor, like ethanol, methanol, and membrane bound glucose dehydrogenases. The alignment model contains an 8-bladed beta-propeller.
Probab=97.72 E-value=0.019 Score=52.48 Aligned_cols=183 Identities=17% Similarity=0.162 Sum_probs=99.6
Q ss_pred CCCcEEEEEccCCeeEEEecCCCCC-------------------Ce-EEEEEecCCCEEEEEeCCC--------------
Q 036605 50 SNGDILAVDVLTGEMKWKSTGRHPG-------------------GL-AGLAFAKKGRSLHVVGTNG-------------- 95 (340)
Q Consensus 50 ~dg~i~i~d~~~~~~~~~~~~~h~~-------------------~v-~~v~~~~~~~~l~s~~~dg-------------- 95 (340)
.+|.|+.+|..+|+.++++...... .| ...++.+.+..++.++.++
T Consensus 173 ~~g~v~alD~~TG~~~W~~~~~~~~~~~~~~~~~~~~~~~~~g~~vw~~pa~d~~~g~V~vg~~~g~~~~~~~~~~~~~~ 252 (488)
T cd00216 173 VRGALRAYDVETGKLLWRFYTTEPDPNAFPTWGPDRQMWGPGGGTSWASPTYDPKTNLVYVGTGNGSPWNWGGRRTPGDN 252 (488)
T ss_pred CCcEEEEEECCCCceeeEeeccCCCcCCCCCCCCCcceecCCCCCccCCeeEeCCCCEEEEECCCCCCCccCCccCCCCC
Confidence 3688999999999999887542110 01 1234445567788877665
Q ss_pred ----cEEEEeCCCCeEEEEeecCCCCe------eEEEEc----cCCC---EEEEe--cCcEEEEECCCCceeEEeecCCC
Q 036605 96 ----MASEMKSEMGEVIREFKASEKPI------SSSAFL----CEEK---IFALA--SSEVRILSLENGEEVLKFSDDVG 156 (340)
Q Consensus 96 ----~i~~wd~~~~~~~~~~~~~~~~i------~~l~~~----~~~~---~l~~~--~~~i~i~d~~~~~~~~~~~~~~~ 156 (340)
.|.-+|..+|+.+..+....... ....+. -++. .++.+ ++.+..+|..+|+.+-.....
T Consensus 253 ~~~~~l~Ald~~tG~~~W~~~~~~~~~~~~~~~s~p~~~~~~~~~g~~~~~V~~g~~~G~l~ald~~tG~~~W~~~~~-- 330 (488)
T cd00216 253 LYTDSIVALDADTGKVKWFYQTTPHDLWDYDGPNQPSLADIKPKDGKPVPAIVHAPKNGFFYVLDRTTGKLISARPEV-- 330 (488)
T ss_pred CceeeEEEEcCCCCCEEEEeeCCCCCCcccccCCCCeEEeccccCCCeeEEEEEECCCceEEEEECCCCcEeeEeEee--
Confidence 79999999999987765322111 111111 1232 34444 455999999999887554321
Q ss_pred CeEEEEECCCCCEEEEEE-----------------cCCCeEEEEEccCCCCCccCCceeeecC-C----CeeeeeecCCC
Q 036605 157 PLQYVSASDGAKIIITAG-----------------YGEKHLQVWRCDISSKTVNKGPALSMRH-S----PVAIDCKNSPN 214 (340)
Q Consensus 157 ~v~~~~~s~~~~~l~s~~-----------------~~d~~i~iwd~~~~~~~~~~~~~~~~~~-~----~~~~~~~~~~~ 214 (340)
...+..+| + .++... ..++.+.-.|+ .+++..-........ . ...... ..
T Consensus 331 -~~~~~~~~-~-~vyv~~~~~~~~~~~~~~~~~~~~~~G~l~AlD~--~tG~~~W~~~~~~~~~~~~~g~~~~~~--~~- 402 (488)
T cd00216 331 -EQPMAYDP-G-LVYLGAFHIPLGLPPQKKKRCKKPGKGGLAALDP--KTGKVVWEKREGTIRDSWNIGFPHWGG--SL- 402 (488)
T ss_pred -ccccccCC-c-eEEEccccccccCcccccCCCCCCCceEEEEEeC--CCCcEeeEeeCCccccccccCCcccCc--ce-
Confidence 01122333 1 222211 11345555555 344332221110000 0 000000 00
Q ss_pred CCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 215 GEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 215 ~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
...+..|++++.||.|+.+|..+++.+-
T Consensus 403 ~~~g~~v~~g~~dG~l~ald~~tG~~lW 430 (488)
T cd00216 403 ATAGNLVFAGAADGYFRAFDATTGKELW 430 (488)
T ss_pred EecCCeEEEECCCCeEEEEECCCCceee
Confidence 1245678889999999999999988776
No 351
>KOG1832 consensus HIV-1 Vpr-binding protein [Cell cycle control, cell division, chromosome partitioning]
Probab=97.70 E-value=5.7e-05 Score=69.76 Aligned_cols=162 Identities=12% Similarity=0.073 Sum_probs=109.3
Q ss_pred EEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc----EEEE
Q 036605 65 KWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE----VRIL 140 (340)
Q Consensus 65 ~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~----i~i~ 140 (340)
...+.. |....+|++|+.+.+.|+.|+..|.|+++++.+|.......+|..+++-+.-+.+|..+++.+.. ..+|
T Consensus 1094 w~~frd-~~~~fTc~afs~~~~hL~vG~~~Geik~~nv~sG~~e~s~ncH~SavT~vePs~dgs~~Ltsss~S~PlsaLW 1172 (1516)
T KOG1832|consen 1094 WRSFRD-ETALFTCIAFSGGTNHLAVGSHAGEIKIFNVSSGSMEESVNCHQSAVTLVEPSVDGSTQLTSSSSSSPLSALW 1172 (1516)
T ss_pred chhhhc-cccceeeEEeecCCceEEeeeccceEEEEEccCccccccccccccccccccccCCcceeeeeccccCchHHHh
Confidence 334555 88889999999999999999999999999999999999999999999999999999888763322 7799
Q ss_pred ECCC-CceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCC
Q 036605 141 SLEN-GEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGT 219 (340)
Q Consensus 141 d~~~-~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 219 (340)
++.+ +.....|. .-.++.|+.....-+.+.. .....+||+ .++.....+............+ ..| +|+..
T Consensus 1173 ~~~s~~~~~Hsf~----ed~~vkFsn~~q~r~~gt~-~d~a~~YDv--qT~~~l~tylt~~~~~~y~~n~-a~F-sP~D~ 1243 (1516)
T KOG1832|consen 1173 DASSTGGPRHSFD----EDKAVKFSNSLQFRALGTE-ADDALLYDV--QTCSPLQTYLTDTVTSSYSNNL-AHF-SPCDT 1243 (1516)
T ss_pred ccccccCcccccc----ccceeehhhhHHHHHhccc-ccceEEEec--ccCcHHHHhcCcchhhhhhccc-ccc-CCCcc
Confidence 9865 33334443 2456788776555455444 467789999 4543332211000001111111 133 77777
Q ss_pred EEEEEeCCCcEEEEECCCCCcc
Q 036605 220 VILAVAESGVAYSWDLKTVSQD 241 (340)
Q Consensus 220 ~l~~~s~dg~i~vwd~~~~~~~ 241 (340)
.++ +|| .+||++..+.+
T Consensus 1244 LIl---ndG--vLWDvR~~~aI 1260 (1516)
T KOG1832|consen 1244 LIL---NDG--VLWDVRIPEAI 1260 (1516)
T ss_pred eEe---eCc--eeeeeccHHHH
Confidence 665 466 35888764433
No 352
>smart00320 WD40 WD40 repeats. Note that these repeats are permuted with respect to the structural repeats (blades) of the beta propeller domain.
Probab=97.68 E-value=0.00017 Score=39.44 Aligned_cols=38 Identities=24% Similarity=0.404 Sum_probs=32.5
Q ss_pred eeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEe
Q 036605 63 EMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMK 101 (340)
Q Consensus 63 ~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd 101 (340)
+....+.. |...|.++.|++++..+++++.|+.+++|+
T Consensus 3 ~~~~~~~~-~~~~i~~~~~~~~~~~~~~~~~d~~~~~~~ 40 (40)
T smart00320 3 ELLKTLKG-HTGPVTSVAFSPDGKYLASASDDGTIKLWD 40 (40)
T ss_pred EEEEEEEe-cCCceeEEEECCCCCEEEEecCCCeEEEcC
Confidence 34455565 888999999999999999999999999996
No 353
>PF15492 Nbas_N: Neuroblastoma-amplified sequence, N terminal
Probab=97.67 E-value=0.0078 Score=48.86 Aligned_cols=151 Identities=16% Similarity=0.157 Sum_probs=82.6
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCC-----eeEEE--ecCCCCCCeEEEEEecCCCEEEEEeC
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTG-----EMKWK--STGRHPGGLAGLAFAKKGRSLHVVGT 93 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~-----~~~~~--~~~~h~~~v~~v~~~~~~~~l~s~~~ 93 (340)
...|..|.|.+... ......-|++-...|.++-|-+..+ +..+. +...++..|.++.++|..++|+.||.
T Consensus 91 ~~Aiagl~Fl~~~~---s~~ws~ELlvi~Y~G~L~Sy~vs~gt~q~y~e~hsfsf~~~yp~Gi~~~vy~p~h~LLlVgG~ 167 (282)
T PF15492_consen 91 SDAIAGLIFLEYKK---SAQWSYELLVINYRGQLRSYLVSVGTNQGYQENHSFSFSSHYPHGINSAVYHPKHRLLLVGGC 167 (282)
T ss_pred ccceeeeEeecccc---ccccceeEEEEeccceeeeEEEEcccCCcceeeEEEEecccCCCceeEEEEcCCCCEEEEecc
Confidence 45677777764321 1222224555567888887776432 23333 33335779999999999888888775
Q ss_pred CCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEE---EE-------ecCcEEEEECCCCceeEEeecCCCCeEEEEE
Q 036605 94 NGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIF---AL-------ASSEVRILSLENGEEVLKFSDDVGPLQYVSA 163 (340)
Q Consensus 94 dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l---~~-------~~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~ 163 (340)
... +.+. .++....+++-.+-.+..+. .. ......+|.+-+.+...........|..|..
T Consensus 168 ~~~------~~~~----s~a~~~GLtaWRiL~~~Pyyk~v~~~~~~~~~~~~~~~~~~~~~~~~fs~~~~~~d~i~kmSl 237 (282)
T PF15492_consen 168 EQN------QDGM----SKASSCGLTAWRILSDSPYYKQVTSSEDDITASSKRRGLLRIPSFKFFSRQGQEQDGIFKMSL 237 (282)
T ss_pred CCC------CCcc----ccccccCceEEEEcCCCCcEEEccccCccccccccccceeeccceeeeeccccCCCceEEEEE
Confidence 422 0000 01111222222221111111 11 1111233333332221111234567999999
Q ss_pred CCCCCEEEEEEcCCCeEEEEEc
Q 036605 164 SDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 164 s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
||||..|++... +|.|.+|++
T Consensus 238 SPdg~~La~ih~-sG~lsLW~i 258 (282)
T PF15492_consen 238 SPDGSLLACIHF-SGSLSLWEI 258 (282)
T ss_pred CCCCCEEEEEEc-CCeEEEEec
Confidence 999999999888 999999999
No 354
>PF06433 Me-amine-dh_H: Methylamine dehydrogenase heavy chain (MADH); InterPro: IPR009451 Methylamine dehydrogenase (1.4.99.3 from EC) is a periplasmic quinoprotein found in several methyltrophic bacteria []. It is induced when grown on methylamine as a carbon source MADH and catalyses the oxidative deamination of amines to their corresponding aldehydes. The redox cofactor of this enzyme is tryptophan tryptophylquinone (TTQ). Electrons derived from the oxidation of methylamine are passed to an electron acceptor, which is usually the blue-copper protein amicyanin (IPR002386 from INTERPRO). RCH2NH2 + H2O + acceptor = RCHO + NH3 + reduced acceptor MADH is a hetero-tetramer, comprised of two heavy subunits and two light subunits. The heavy subunit forms a seven-bladed beta-propeller like structure [].; GO: 0030058 amine dehydrogenase activity, 0030416 methylamine metabolic process, 0055114 oxidation-reduction process, 0042597 periplasmic space; PDB: 3RN1_F 3SVW_F 3PXT_F 3L4O_F 3L4M_D 3SJL_F 3PXS_D 3ORV_F 3RMZ_F 3RLM_F ....
Probab=97.67 E-value=0.0079 Score=50.78 Aligned_cols=147 Identities=16% Similarity=0.213 Sum_probs=92.1
Q ss_pred EEEEEcCCCcEEEEEcc-CCeeEEEe----cCCCCCCe-EEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEE--Eeec--
Q 036605 44 LLALGTSNGDILAVDVL-TGEMKWKS----TGRHPGGL-AGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIR--EFKA-- 113 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~-~~~~~~~~----~~~h~~~v-~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~--~~~~-- 113 (340)
-+.+-+.||.+.-+.+. .|+...+. .. -..++ ..-++...+..++..+.+|.|+-.|+....... .+..
T Consensus 149 ~F~~lC~DGsl~~v~Ld~~Gk~~~~~t~~F~~-~~dp~f~~~~~~~~~~~~~F~Sy~G~v~~~dlsg~~~~~~~~~~~~t 227 (342)
T PF06433_consen 149 GFSMLCGDGSLLTVTLDADGKEAQKSTKVFDP-DDDPLFEHPAYSRDGGRLYFVSYEGNVYSADLSGDSAKFGKPWSLLT 227 (342)
T ss_dssp EEEEEETTSCEEEEEETSTSSEEEEEEEESST-TTS-B-S--EEETTTTEEEEEBTTSEEEEEEETTSSEEEEEEEESS-
T ss_pred ceEEEecCCceEEEEECCCCCEeEeeccccCC-CCcccccccceECCCCeEEEEecCCEEEEEeccCCcccccCcccccC
Confidence 47777889999998887 55543222 11 22223 344556666667767999999998887654322 2211
Q ss_pred --------CCCCeeEEEEccCCCEEEE-e----c-------CcEEEEECCCCceeEEeecCCCCeEEEEECCCCC-EEEE
Q 036605 114 --------SEKPISSSAFLCEEKIFAL-A----S-------SEVRILSLENGEEVLKFSDDVGPLQYVSASDGAK-IIIT 172 (340)
Q Consensus 114 --------~~~~i~~l~~~~~~~~l~~-~----~-------~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~-~l~s 172 (340)
-.+.-.-+++++....|++ . . ..|++||+.+++.+.++.. ..++.++..+.+.+ +|++
T Consensus 228 ~~e~~~~WrPGG~Q~~A~~~~~~rlyvLMh~g~~gsHKdpgteVWv~D~~t~krv~Ri~l-~~~~~Si~Vsqd~~P~L~~ 306 (342)
T PF06433_consen 228 DAEKADGWRPGGWQLIAYHAASGRLYVLMHQGGEGSHKDPGTEVWVYDLKTHKRVARIPL-EHPIDSIAVSQDDKPLLYA 306 (342)
T ss_dssp HHHHHTTEEE-SSS-EEEETTTTEEEEEEEE--TT-TTS-EEEEEEEETTTTEEEEEEEE-EEEESEEEEESSSS-EEEE
T ss_pred ccccccCcCCcceeeeeeccccCeEEEEecCCCCCCccCCceEEEEEECCCCeEEEEEeC-CCccceEEEccCCCcEEEE
Confidence 1123456788876666544 1 1 1199999999999988863 24577899988776 5555
Q ss_pred EEcCCCeEEEEEccCCCCCccC
Q 036605 173 AGYGEKHLQVWRCDISSKTVNK 194 (340)
Q Consensus 173 ~~~~d~~i~iwd~~~~~~~~~~ 194 (340)
....++.+.+||. .+++...
T Consensus 307 ~~~~~~~l~v~D~--~tGk~~~ 326 (342)
T PF06433_consen 307 LSAGDGTLDVYDA--ATGKLVR 326 (342)
T ss_dssp EETTTTEEEEEET--TT--EEE
T ss_pred EcCCCCeEEEEeC--cCCcEEe
Confidence 4555899999998 4555443
No 355
>KOG1008 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=97.67 E-value=1.1e-05 Score=71.53 Aligned_cols=158 Identities=9% Similarity=0.001 Sum_probs=104.2
Q ss_pred CCCCCeEEEEeeccc-cccccccCceEEEEEc----CCCcEEEEEccCC--e--eEEEecCCCCCCeEEEEEecCCCEEE
Q 036605 19 EPVVSYSCLACGFVG-KKRRKERGTLLLALGT----SNGDILAVDVLTG--E--MKWKSTGRHPGGLAGLAFAKKGRSLH 89 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~-~~~~~~~~~~~l~~g~----~dg~i~i~d~~~~--~--~~~~~~~~h~~~v~~v~~~~~~~~l~ 89 (340)
.+...|+|++|++-. . .||+|- .|..+.|||+.++ . ....+..+.......++|..+.+.+.
T Consensus 100 ~~ar~Ct~lAwneLDtn---------~LAagldkhrnds~~~Iwdi~s~ltvPke~~~fs~~~l~gqns~cwlrd~klvl 170 (783)
T KOG1008|consen 100 GYARPCTSLAWNELDTN---------HLAAGLDKHRNDSSLKIWDINSLLTVPKESPLFSSSTLDGQNSVCWLRDTKLVL 170 (783)
T ss_pred cccccccccccccccHH---------HHHhhhhhhcccCCccceecccccCCCccccccccccccCccccccccCcchhh
Confidence 466889999999875 4 677774 4578999999876 1 22223222334567899998889999
Q ss_pred EEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEcc-CCCEEEE-ecCcEEEEE-CCCCce-eEEeecCC----CCeEEE
Q 036605 90 VVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLC-EEKIFAL-ASSEVRILS-LENGEE-VLKFSDDV----GPLQYV 161 (340)
Q Consensus 90 s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~-~~~~l~~-~~~~i~i~d-~~~~~~-~~~~~~~~----~~v~~~ 161 (340)
+|.....+.++|++.... .........+..+.+.| .+.++++ .++.|-+|| ...-+. +..+...+ ..+..+
T Consensus 171 aGm~sr~~~ifdlRqs~~-~~~svnTk~vqG~tVdp~~~nY~cs~~dg~iAiwD~~rnienpl~~i~~~~N~~~~~l~~~ 249 (783)
T KOG1008|consen 171 AGMTSRSVHIFDLRQSLD-SVSSVNTKYVQGITVDPFSPNYFCSNSDGDIAIWDTYRNIENPLQIILRNENKKPKQLFAL 249 (783)
T ss_pred cccccchhhhhhhhhhhh-hhhhhhhhhcccceecCCCCCceeccccCceeeccchhhhccHHHHHhhCCCCcccceeeE
Confidence 998889999999873321 11112234567788888 6777766 566699999 333222 22222222 248889
Q ss_pred EECCCCCE-EEEEEcCCCeEEEEEcc
Q 036605 162 SASDGAKI-IITAGYGEKHLQVWRCD 186 (340)
Q Consensus 162 ~~s~~~~~-l~s~~~~d~~i~iwd~~ 186 (340)
+|.|...- +++.....++|+.+|+.
T Consensus 250 aycPtrtglla~l~RdS~tIrlydi~ 275 (783)
T KOG1008|consen 250 AYCPTRTGLLAVLSRDSITIRLYDIC 275 (783)
T ss_pred EeccCCcchhhhhccCcceEEEeccc
Confidence 99886543 34444446899999985
No 356
>PF00930 DPPIV_N: Dipeptidyl peptidase IV (DPP IV) N-terminal region; InterPro: IPR002469 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This domain defines serine peptidases belonging to MEROPS peptidase family S9 (clan SC), subfamily S9B (dipeptidyl-peptidase IV). The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. This domain is an alignment of the region to the N-terminal side of the active site, which is found in IPR001375 from INTERPRO. CD26 (3.4.14.5 from EC) is also called adenosine deaminase-binding protein (ADA-binding protein) or dipeptidylpeptidase IV (DPP IV ectoenzyme). The exopeptidase cleaves off N-terminal X-Pro or X-Ala dipeptides from polypeptides (dipeptidyl peptidase IV activity). CD26 serves as the costimulatory molecule in T cell activation and is an associated marker of autoimmune diseases, adenosine deaminase-deficiency and HIV pathogenesis. Dipeptidyl peptidase IV (DPP IV) is responsible for the removal of N-terminal dipeptides sequentially from polypeptides having unsubstituted N termini, provided that the penultimate residue is proline. The enzyme catalyses the reaction: Dipeptidyl-Polypeptide + H(2)O = Dipeptide + Polypeptide It is a type II membrane protein that forms a homodimer. CD molecules are leucocyte antigens on cell surfaces. CD antigens nomenclature is updated at Protein Reviews On The Web (http://prow.nci.nih.gov/). ; GO: 0006508 proteolysis, 0016020 membrane; PDB: 2RIP_A 3Q8W_B 2AJL_I 1TKR_B 1TK3_B 3C45_A 2G5P_A 3G0C_D 1R9M_C 1RWQ_A ....
Probab=97.66 E-value=0.0056 Score=53.42 Aligned_cols=79 Identities=19% Similarity=0.196 Sum_probs=54.5
Q ss_pred CCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecC----------------
Q 036605 51 NGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKAS---------------- 114 (340)
Q Consensus 51 dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~---------------- 114 (340)
.+.+.+||+++++.. .+.. ....+....|+|+|+.++... ++.|.+++..++...+.-...
T Consensus 22 ~~~y~i~d~~~~~~~-~l~~-~~~~~~~~~~sP~g~~~~~v~-~~nly~~~~~~~~~~~lT~dg~~~i~nG~~dwvyeEE 98 (353)
T PF00930_consen 22 KGDYYIYDIETGEIT-PLTP-PPPKLQDAKWSPDGKYIAFVR-DNNLYLRDLATGQETQLTTDGEPGIYNGVPDWVYEEE 98 (353)
T ss_dssp EEEEEEEETTTTEEE-ESS--EETTBSEEEE-SSSTEEEEEE-TTEEEEESSTTSEEEESES--TTTEEESB--HHHHHH
T ss_pred ceeEEEEecCCCceE-ECcC-CccccccceeecCCCeeEEEe-cCceEEEECCCCCeEEeccccceeEEcCccceecccc
Confidence 467999999998644 4443 356889999999999988865 568999998887544322111
Q ss_pred -CCCeeEEEEccCCCEEEE
Q 036605 115 -EKPISSSAFLCEEKIFAL 132 (340)
Q Consensus 115 -~~~i~~l~~~~~~~~l~~ 132 (340)
-..-..+.||||+++|+.
T Consensus 99 v~~~~~~~~WSpd~~~la~ 117 (353)
T PF00930_consen 99 VFDRRSAVWWSPDSKYLAF 117 (353)
T ss_dssp TSSSSBSEEE-TTSSEEEE
T ss_pred ccccccceEECCCCCEEEE
Confidence 112357889999998875
No 357
>COG3490 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=97.65 E-value=0.008 Score=48.91 Aligned_cols=143 Identities=12% Similarity=0.142 Sum_probs=93.4
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCc-EEEEEccCCeeEEEecCCCCCC--eEEEEEecCCCEEEEEeCC----
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGD-ILAVDVLTGEMKWKSTGRHPGG--LAGLAFAKKGRSLHVVGTN---- 94 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~-i~i~d~~~~~~~~~~~~~h~~~--v~~v~~~~~~~~l~s~~~d---- 94 (340)
.....++|+|.-. .-++.+-.-|+ ..++|....+....+.. .++. --.=.|||||.+||..-.|
T Consensus 68 aR~Hgi~~~p~~~--------ravafARrPGtf~~vfD~~~~~~pv~~~s-~~~RHfyGHGvfs~dG~~LYATEndfd~~ 138 (366)
T COG3490 68 ARGHGIAFHPALP--------RAVAFARRPGTFAMVFDPNGAQEPVTLVS-QEGRHFYGHGVFSPDGRLLYATENDFDPN 138 (366)
T ss_pred cccCCeecCCCCc--------ceEEEEecCCceEEEECCCCCcCcEEEec-ccCceeecccccCCCCcEEEeecCCCCCC
Confidence 4556788888763 04666655555 46788877765544432 1111 1123689999999987554
Q ss_pred -CcEEEEeCCCC-eEEEEeecCCCCeeEEEEccCCCEEEEecCc--------------------EEEEECCCCceeEEe-
Q 036605 95 -GMASEMKSEMG-EVIREFKASEKPISSSAFLCEEKIFALASSE--------------------VRILSLENGEEVLKF- 151 (340)
Q Consensus 95 -g~i~~wd~~~~-~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--------------------i~i~d~~~~~~~~~~- 151 (340)
|.|-+||.+.+ +.+.+|..|.-....+.+.+||+.++.+++- +.+.|..+|..+.+.
T Consensus 139 rGViGvYd~r~~fqrvgE~~t~GiGpHev~lm~DGrtlvvanGGIethpdfgR~~lNldsMePSlvlld~atG~liekh~ 218 (366)
T COG3490 139 RGVIGVYDAREGFQRVGEFSTHGIGPHEVTLMADGRTLVVANGGIETHPDFGRTELNLDSMEPSLVLLDAATGNLIEKHT 218 (366)
T ss_pred CceEEEEecccccceecccccCCcCcceeEEecCCcEEEEeCCceecccccCccccchhhcCccEEEEeccccchhhhcc
Confidence 78999998754 3455677787788999999999999987764 334454555544332
Q ss_pred -e--cCCCCeEEEEECCCCCEEEEE
Q 036605 152 -S--DDVGPLQYVSASDGAKIIITA 173 (340)
Q Consensus 152 -~--~~~~~v~~~~~s~~~~~l~s~ 173 (340)
. .+.-.+..+...+||...+.+
T Consensus 219 Lp~~l~~lSiRHld~g~dgtvwfgc 243 (366)
T COG3490 219 LPASLRQLSIRHLDIGRDGTVWFGC 243 (366)
T ss_pred CchhhhhcceeeeeeCCCCcEEEEE
Confidence 2 344568888888888655543
No 358
>smart00320 WD40 WD40 repeats. Note that these repeats are permuted with respect to the structural repeats (blades) of the beta propeller domain.
Probab=97.63 E-value=0.00017 Score=39.43 Aligned_cols=39 Identities=31% Similarity=0.325 Sum_probs=32.9
Q ss_pred CceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEE
Q 036605 7 GSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVD 58 (340)
Q Consensus 7 g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d 58 (340)
++....+. .|...|.++.|++.+. ++++++.|+.+++|+
T Consensus 2 ~~~~~~~~----~~~~~i~~~~~~~~~~---------~~~~~~~d~~~~~~~ 40 (40)
T smart00320 2 GELLKTLK----GHTGPVTSVAFSPDGK---------YLASASDDGTIKLWD 40 (40)
T ss_pred cEEEEEEE----ecCCceeEEEECCCCC---------EEEEecCCCeEEEcC
Confidence 34555666 6788999999999888 899999999999996
No 359
>COG3391 Uncharacterized conserved protein [Function unknown]
Probab=97.62 E-value=0.041 Score=48.57 Aligned_cols=202 Identities=12% Similarity=0.129 Sum_probs=126.9
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEe-CCCcEEEEe
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVG-TNGMASEMK 101 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~-~dg~i~~wd 101 (340)
....+...|++. ...++-.....+...+............ -...-..++.++.+..++... .+..|.+.|
T Consensus 32 ~~~~v~~~~~g~--------~~~v~~~~~~~~~~~~~~~n~~~~~~~~-g~~~p~~i~v~~~~~~vyv~~~~~~~v~vid 102 (381)
T COG3391 32 GPGGVAVNPDGT--------QVYVANSGSNDVSVIDATSNTVTQSLSV-GGVYPAGVAVNPAGNKVYVTTGDSNTVSVID 102 (381)
T ss_pred CCceeEEcCccC--------EEEEEeecCceeeecccccceeeeeccC-CCccccceeeCCCCCeEEEecCCCCeEEEEc
Confidence 344556667773 0344433333566666552222221221 113346778888888666655 458999999
Q ss_pred CCCCeEEEEeecCCCCeeEEEEccCCCEEEEec-----CcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcC
Q 036605 102 SEMGEVIREFKASEKPISSSAFLCEEKIFALAS-----SEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYG 176 (340)
Q Consensus 102 ~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~-----~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~ 176 (340)
..+........... ....++++|+++.+.+++ ..+.+.|..+++.+.....-..+ ..++++|+|..++.+...
T Consensus 103 ~~~~~~~~~~~vG~-~P~~~~~~~~~~~vYV~n~~~~~~~vsvid~~t~~~~~~~~vG~~P-~~~a~~p~g~~vyv~~~~ 180 (381)
T COG3391 103 TATNTVLGSIPVGL-GPVGLAVDPDGKYVYVANAGNGNNTVSVIDAATNKVTATIPVGNTP-TGVAVDPDGNKVYVTNSD 180 (381)
T ss_pred CcccceeeEeeecc-CCceEEECCCCCEEEEEecccCCceEEEEeCCCCeEEEEEecCCCc-ceEEECCCCCeEEEEecC
Confidence 88777766655444 567899999998886633 33899999888887775433344 889999999988888866
Q ss_pred CCeEEEEEccCCCCCccC-Cc--eeeecCCCeeeeeecCCCCCCCCEEEEEeCC---CcEEEEECCCCCccC
Q 036605 177 EKHLQVWRCDISSKTVNK-GP--ALSMRHSPVAIDCKNSPNGEDGTVILAVAES---GVAYSWDLKTVSQDE 242 (340)
Q Consensus 177 d~~i~iwd~~~~~~~~~~-~~--~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~d---g~i~vwd~~~~~~~~ 242 (340)
++.|.+.|.. ...... .. .......+....+ .+++.++...... +.+...|..+.....
T Consensus 181 ~~~v~vi~~~--~~~v~~~~~~~~~~~~~~P~~i~v-----~~~g~~~yV~~~~~~~~~v~~id~~~~~v~~ 245 (381)
T COG3391 181 DNTVSVIDTS--GNSVVRGSVGSLVGVGTGPAGIAV-----DPDGNRVYVANDGSGSNNVLKIDTATGNVTA 245 (381)
T ss_pred CCeEEEEeCC--CcceeccccccccccCCCCceEEE-----CCCCCEEEEEeccCCCceEEEEeCCCceEEE
Confidence 9999999973 322221 10 1222344455555 7888866555443 578888887754443
No 360
>PF08596 Lgl_C: Lethal giant larvae(Lgl) like, C-terminal; InterPro: IPR013905 The Lethal giant larvae (Lgl) tumour suppressor protein is conserved from yeast to mammals. The Lgl protein functions in cell polarity, at least in part, by regulating SNARE-mediated membrane delivery events at the cell surface []. The N-terminal half of Lgl members contains WD40 repeats (see IPR001680 from INTERPRO), while the C-terminal half appears specific to the protein []. ; PDB: 2OAJ_A.
Probab=97.62 E-value=0.0027 Score=55.76 Aligned_cols=155 Identities=15% Similarity=0.225 Sum_probs=86.5
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEe-------cCCCCCCeEEEEEec-----CC--
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKS-------TGRHPGGLAGLAFAK-----KG-- 85 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~-------~~~h~~~v~~v~~~~-----~~-- 85 (340)
..++|++++.|.-| ++|+|..+|.+.|.|++....++.- .......|+++.|.- |+
T Consensus 85 ~~g~vtal~~S~iG----------Fvaigy~~G~l~viD~RGPavI~~~~i~~~~~~~~~~~~vt~ieF~vm~~~~D~yS 154 (395)
T PF08596_consen 85 KQGPVTALKNSDIG----------FVAIGYESGSLVVIDLRGPAVIYNENIRESFLSKSSSSYVTSIEFSVMTLGGDGYS 154 (395)
T ss_dssp -S-SEEEEEE-BTS----------EEEEEETTSEEEEEETTTTEEEEEEEGGG--T-SS----EEEEEEEEEE-TTSSSE
T ss_pred cCCcEeEEecCCCc----------EEEEEecCCcEEEEECCCCeEEeeccccccccccccccCeeEEEEEEEecCCCccc
Confidence 36899999998444 5999999999999999888766652 112345688888863 22
Q ss_pred -CEEEEEeCCCcEEEEeCCC---CeEEEE----eecCCCCeeEEE-Ecc----------------------CCCEEEEec
Q 036605 86 -RSLHVVGTNGMASEMKSEM---GEVIRE----FKASEKPISSSA-FLC----------------------EEKIFALAS 134 (340)
Q Consensus 86 -~~l~s~~~dg~i~~wd~~~---~~~~~~----~~~~~~~i~~l~-~~~----------------------~~~~l~~~~ 134 (340)
-.|++|...|.+.+|.+.. +..... ...+.+++..|. ++. .+-.++++.
T Consensus 155 Si~L~vGTn~G~v~~fkIlp~~~g~f~v~~~~~~~~~~~~i~~I~~i~~~~G~~a~At~~~~~~l~~g~~i~g~vVvvSe 234 (395)
T PF08596_consen 155 SICLLVGTNSGNVLTFKILPSSNGRFSVQFAGATTNHDSPILSIIPINADTGESALATISAMQGLSKGISIPGYVVVVSE 234 (395)
T ss_dssp EEEEEEEETTSEEEEEEEEE-GGG-EEEEEEEEE--SS----EEEEEETTT--B-B-BHHHHHGGGGT----EEEEEE-S
T ss_pred ceEEEEEeCCCCEEEEEEecCCCCceEEEEeeccccCCCceEEEEEEECCCCCcccCchhHhhccccCCCcCcEEEEEcc
Confidence 3688888889999997641 221111 123445554443 221 122344466
Q ss_pred CcEEEEECCCCceeEEeecCCCCeEEEEEC-----CCCCEEEEEEcCCCeEEEEEc
Q 036605 135 SEVRILSLENGEEVLKFSDDVGPLQYVSAS-----DGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 135 ~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s-----~~~~~l~s~~~~d~~i~iwd~ 185 (340)
.+++++.+.+.+...+.......+..+.+- ..+..|++ -..+|.+++|.+
T Consensus 235 ~~irv~~~~~~k~~~K~~~~~~~~~~~~vv~~~~~~~~~~Lv~-l~~~G~i~i~SL 289 (395)
T PF08596_consen 235 SDIRVFKPPKSKGAHKSFDDPFLCSSASVVPTISRNGGYCLVC-LFNNGSIRIYSL 289 (395)
T ss_dssp SEEEEE-TT---EEEEE-SS-EEEEEEEEEEEE-EEEEEEEEE-EETTSEEEEEET
T ss_pred cceEEEeCCCCcccceeeccccccceEEEEeecccCCceEEEE-EECCCcEEEEEC
Confidence 669999998877665544332333444452 23444444 445999999999
No 361
>PF14583 Pectate_lyase22: Oligogalacturonate lyase; PDB: 3C5M_C 3PE7_A.
Probab=97.61 E-value=0.0095 Score=51.28 Aligned_cols=222 Identities=17% Similarity=0.154 Sum_probs=104.1
Q ss_pred cCCCCceeeeeeCCCC-CCCCCeEEEEeeccccccccccCceEEEEEcCCC--cEEEEEccCCeeEEEecCCCCCCeEEE
Q 036605 3 STNDGSLLAEWKQPDG-EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNG--DILAVDVLTGEMKWKSTGRHPGGLAGL 79 (340)
Q Consensus 3 d~~~g~~~~~~~~~~~-~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg--~i~i~d~~~~~~~~~~~~~h~~~v~~v 79 (340)
|..+|..+-.+++... .|.--.+.=+|.++|+ .+|+.+..+| .+++.|+.+++..+-..+ -.......
T Consensus 16 D~~TG~~VtrLT~~~~~~h~~YF~~~~ft~dG~--------kllF~s~~dg~~nly~lDL~t~~i~QLTdg-~g~~~~g~ 86 (386)
T PF14583_consen 16 DPDTGHRVTRLTPPDGHSHRLYFYQNCFTDDGR--------KLLFASDFDGNRNLYLLDLATGEITQLTDG-PGDNTFGG 86 (386)
T ss_dssp -TTT--EEEE-S-TTS-EE---TTS--B-TTS---------EEEEEE-TTSS-EEEEEETTT-EEEE---S-S-B-TTT-
T ss_pred CCCCCceEEEecCCCCcccceeecCCCcCCCCC--------EEEEEeccCCCcceEEEEcccCEEEECccC-CCCCccce
Confidence 5677777766664311 0111112234677784 1666666565 567778999875543332 11223356
Q ss_pred EEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEE--ccCCCEEEEe-----cC-----------------
Q 036605 80 AFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAF--LCEEKIFALA-----SS----------------- 135 (340)
Q Consensus 80 ~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~--~~~~~~l~~~-----~~----------------- 135 (340)
.++|+++.++.......|...|+.+.+....+.....-+-...| +.++..++.. +.
T Consensus 87 ~~s~~~~~~~Yv~~~~~l~~vdL~T~e~~~vy~~p~~~~g~gt~v~n~d~t~~~g~e~~~~d~~~l~~~~~f~e~~~a~p 166 (386)
T PF14583_consen 87 FLSPDDRALYYVKNGRSLRRVDLDTLEERVVYEVPDDWKGYGTWVANSDCTKLVGIEISREDWKPLTKWKGFREFYEARP 166 (386)
T ss_dssp EE-TTSSEEEEEETTTEEEEEETTT--EEEEEE--TTEEEEEEEEE-TTSSEEEEEEEEGGG-----SHHHHHHHHHC--
T ss_pred EEecCCCeEEEEECCCeEEEEECCcCcEEEEEECCcccccccceeeCCCccEEEEEEEeehhccCccccHHHHHHHhhCC
Confidence 77888888877766778999999998876666655554433444 4456665431 10
Q ss_pred --cEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEc-C--CC-eEEEEEccCCCCCccCCceeeecCCCeeeee
Q 036605 136 --EVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGY-G--EK-HLQVWRCDISSKTVNKGPALSMRHSPVAIDC 209 (340)
Q Consensus 136 --~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~-~--d~-~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~ 209 (340)
.|.-.|+.+|+....+. -...+..+.|+|....+++-+- + +. .-+||-++...... ..+. .+.+... +
T Consensus 167 ~~~i~~idl~tG~~~~v~~-~~~wlgH~~fsP~dp~li~fCHEGpw~~Vd~RiW~i~~dg~~~-~~v~---~~~~~e~-~ 240 (386)
T PF14583_consen 167 HCRIFTIDLKTGERKVVFE-DTDWLGHVQFSPTDPTLIMFCHEGPWDLVDQRIWTINTDGSNV-KKVH---RRMEGES-V 240 (386)
T ss_dssp -EEEEEEETTT--EEEEEE-ESS-EEEEEEETTEEEEEEEEE-S-TTTSS-SEEEEETTS----EESS------TTEE-E
T ss_pred CceEEEEECCCCceeEEEe-cCccccCcccCCCCCCEEEEeccCCcceeceEEEEEEcCCCcc-eeee---cCCCCcc-c
Confidence 16667888886544443 4567889999998766665433 2 22 13677775333222 2121 1222111 1
Q ss_pred ecCCCCCCCCEEEEEeC-----CCcEEEEECCCCC
Q 036605 210 KNSPNGEDGTVILAVAE-----SGVAYSWDLKTVS 239 (340)
Q Consensus 210 ~~~~~~~~~~~l~~~s~-----dg~i~vwd~~~~~ 239 (340)
..-|+.+||..+.-.+. +..|.-+|+.+++
T Consensus 241 gHEfw~~DG~~i~y~~~~~~~~~~~i~~~d~~t~~ 275 (386)
T PF14583_consen 241 GHEFWVPDGSTIWYDSYTPGGQDFWIAGYDPDTGE 275 (386)
T ss_dssp EEEEE-TTSS-EEEEEEETTT--EEEEEE-TTT--
T ss_pred ccccccCCCCEEEEEeecCCCCceEEEeeCCCCCC
Confidence 11223788877654332 3346666777654
No 362
>PF04053 Coatomer_WDAD: Coatomer WD associated region ; InterPro: IPR006692 Proteins synthesised on the ribosome and processed in the endoplasmic reticulum are transported from the Golgi apparatus to the trans-Golgi network (TGN), and from there via small carrier vesicles to their final destination compartment. This traffic is bidirectional, to ensure that proteins required to form vesicles are recycled. Vesicles have specific coat proteins (such as clathrin or coatomer) that are important for cargo selection and direction of transfer []. While clathrin mediates endocytic protein transport, and transport from ER to Golgi, coatomers primarily mediate intra-Golgi transport, as well as the reverse Golgi to ER transport of dilysine-tagged proteins []. For example, the coatomer COP1 (coat protein complex 1) is responsible for reverse transport of recycled proteins from Golgi and pre-Golgi compartments back to the ER, while COPII buds vesicles from the ER to the Golgi []. Coatomers reversibly associate with Golgi (non-clathrin-coated) vesicles to mediate protein transport and for budding from Golgi membranes []. Activated small guanine triphosphatases (GTPases) attract coat proteins to specific membrane export sites, thereby linking coatomers to export cargos. As coat proteins polymerise, vesicles are formed and budded from membrane-bound organelles. Coatomer complexes also influence Golgi structural integrity, as well as the processing, activity, and endocytic recycling of LDL receptors. In mammals, coatomer complexes can only be recruited by membranes associated to ADP-ribosylation factors (ARFs), which are small GTP-binding proteins. Coatomer complexes are hetero-oligomers composed of at least an alpha, beta, beta', gamma, delta, epsilon and zeta subunits. This entry represents the WD-associated region found in coatomer subunits alpha, beta and beta' subunits. The alpha-subunit (RET1P) of the coatomer complex in Saccharomyces cerevisiae (Baker's yeast), participates in membrane transport between the endoplasmic reticulum and Golgi apparatus. The protein contains six WD-40 repeat motifs in its N-terminal region []. More information about these proteins can be found at Protein of the Month: Clathrin [].; GO: 0005198 structural molecule activity, 0006886 intracellular protein transport, 0016192 vesicle-mediated transport, 0030117 membrane coat; PDB: 3MKQ_B.
Probab=97.60 E-value=0.0013 Score=58.60 Aligned_cols=142 Identities=13% Similarity=0.199 Sum_probs=81.2
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEE
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASE 99 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~ 99 (340)
.......+.++|+|+ ++++ +.+|...||.....+.... +.-...+|.+ .+.+++-.....|.+
T Consensus 31 ~~~~p~~ls~npngr---------~v~V-~g~geY~iyt~~~~r~k~~------G~g~~~vw~~-~n~yAv~~~~~~I~I 93 (443)
T PF04053_consen 31 CEIYPQSLSHNPNGR---------FVLV-CGDGEYEIYTALAWRNKAF------GSGLSFVWSS-RNRYAVLESSSTIKI 93 (443)
T ss_dssp -SS--SEEEE-TTSS---------EEEE-EETTEEEEEETTTTEEEEE------EE-SEEEE-T-SSEEEEE-TTS-EEE
T ss_pred CCcCCeeEEECCCCC---------EEEE-EcCCEEEEEEccCCccccc------CceeEEEEec-CccEEEEECCCeEEE
Confidence 344567899999999 7777 6788888988544443321 2345778988 445666677888988
Q ss_pred EeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc-EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCC
Q 036605 100 MKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE-VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEK 178 (340)
Q Consensus 100 wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~-i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~ 178 (340)
+.--..+....+... ..+..|- + |..|+..+.. |.+||+.+++.++++... +|..+.|++++.+++..+ +.
T Consensus 94 ~kn~~~~~~k~i~~~-~~~~~If--~-G~LL~~~~~~~i~~yDw~~~~~i~~i~v~--~vk~V~Ws~~g~~val~t--~~ 165 (443)
T PF04053_consen 94 YKNFKNEVVKSIKLP-FSVEKIF--G-GNLLGVKSSDFICFYDWETGKLIRRIDVS--AVKYVIWSDDGELVALVT--KD 165 (443)
T ss_dssp EETTEE-TT-----S-S-EEEEE----SSSEEEEETTEEEEE-TTT--EEEEESS---E-EEEEE-TTSSEEEEE---S-
T ss_pred EEcCccccceEEcCC-cccceEE--c-CcEEEEECCCCEEEEEhhHcceeeEEecC--CCcEEEEECCCCEEEEEe--CC
Confidence 632222221223221 1233332 2 7777775555 999999999999888643 489999999999988865 46
Q ss_pred eEEEEEcc
Q 036605 179 HLQVWRCD 186 (340)
Q Consensus 179 ~i~iwd~~ 186 (340)
.+.|++.+
T Consensus 166 ~i~il~~~ 173 (443)
T PF04053_consen 166 SIYILKYN 173 (443)
T ss_dssp SEEEEEE-
T ss_pred eEEEEEec
Confidence 77787763
No 363
>TIGR03075 PQQ_enz_alc_DH PQQ-dependent dehydrogenase, methanol/ethanol family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Genes in this family often are found adjacent to the PQQ biosynthesis genes themselves. An unusual, strained disulfide bond between adjacent Cys residues contributes to PQQ-binding, as does a Trp residue that is part of a PQQ enzyme repeat (see pfam01011). Characterized members include the dehydrogenase subunit of a membrane-anchored, three subunit alcohol (ethanol) dehydrogenase of Gluconobacter suboxydans, a homodimeric ethanol dehydrogenase in Pseudomonas aeruginosa, and the large subunit of an alpha2/beta2 heterotetrameric methanol dehydrogenase in Methylobacterium extorquens.
Probab=97.59 E-value=0.035 Score=51.09 Aligned_cols=190 Identities=15% Similarity=0.173 Sum_probs=108.6
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeE----------EEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeec
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLA----------GLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKA 113 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~----------~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~ 113 (340)
.+++++.++.|+-+|..+|+.++++...-...+. .+++. +..++.++.|+.+.-+|..+|+.+.....
T Consensus 71 ~vyv~s~~g~v~AlDa~TGk~lW~~~~~~~~~~~~~~~~~~~~rg~av~--~~~v~v~t~dg~l~ALDa~TGk~~W~~~~ 148 (527)
T TIGR03075 71 VMYVTTSYSRVYALDAKTGKELWKYDPKLPDDVIPVMCCDVVNRGVALY--DGKVFFGTLDARLVALDAKTGKVVWSKKN 148 (527)
T ss_pred EEEEECCCCcEEEEECCCCceeeEecCCCCcccccccccccccccceEE--CCEEEEEcCCCEEEEEECCCCCEEeeccc
Confidence 5777888899999999999999987641111111 12222 45678888999999999999999877543
Q ss_pred CCC----CeeE-EEEccCCCEEEEe-------cCcEEEEECCCCceeEEeecCCC-------------------------
Q 036605 114 SEK----PISS-SAFLCEEKIFALA-------SSEVRILSLENGEEVLKFSDDVG------------------------- 156 (340)
Q Consensus 114 ~~~----~i~~-l~~~~~~~~l~~~-------~~~i~i~d~~~~~~~~~~~~~~~------------------------- 156 (340)
... .+.+ ..+ -++..++.. ++.|..+|.++|+.+-++..-..
T Consensus 149 ~~~~~~~~~tssP~v-~~g~Vivg~~~~~~~~~G~v~AlD~~TG~~lW~~~~~p~~~~~~~~~~~~~~~~~~~~tw~~~~ 227 (527)
T TIGR03075 149 GDYKAGYTITAAPLV-VKGKVITGISGGEFGVRGYVTAYDAKTGKLVWRRYTVPGDMGYLDKADKPVGGEPGAKTWPGDA 227 (527)
T ss_pred ccccccccccCCcEE-ECCEEEEeecccccCCCcEEEEEECCCCceeEeccCcCCCcccccccccccccccccCCCCCCc
Confidence 211 1111 111 134444332 24599999999987755421110
Q ss_pred ------Ce-EEEEECCCCCEEEEEEcC-----------CC--eEEEEEccCCCCCccCCce--------eeecCCCeeee
Q 036605 157 ------PL-QYVSASDGAKIIITAGYG-----------EK--HLQVWRCDISSKTVNKGPA--------LSMRHSPVAID 208 (340)
Q Consensus 157 ------~v-~~~~~s~~~~~l~s~~~~-----------d~--~i~iwd~~~~~~~~~~~~~--------~~~~~~~~~~~ 208 (340)
.+ ..+.+.+....++.+..+ |+ .-.|.-++..+++..-.+. +.....+..++
T Consensus 228 ~~~gg~~~W~~~s~D~~~~lvy~~tGnp~p~~~~~r~gdnl~~~s~vAld~~TG~~~W~~Q~~~~D~wD~d~~~~p~l~d 307 (527)
T TIGR03075 228 WKTGGGATWGTGSYDPETNLIYFGTGNPSPWNSHLRPGDNLYTSSIVARDPDTGKIKWHYQTTPHDEWDYDGVNEMILFD 307 (527)
T ss_pred cccCCCCccCceeEcCCCCeEEEeCCCCCCCCCCCCCCCCccceeEEEEccccCCEEEeeeCCCCCCccccCCCCcEEEE
Confidence 11 123556655555554321 11 1122222224544322211 11112233333
Q ss_pred eecCCCCCCCC---EEEEEeCCCcEEEEECCCCCcc
Q 036605 209 CKNSPNGEDGT---VILAVAESGVAYSWDLKTVSQD 241 (340)
Q Consensus 209 ~~~~~~~~~~~---~l~~~s~dg~i~vwd~~~~~~~ 241 (340)
+ ..+|. .++.++.+|.+++.|-.+++.+
T Consensus 308 ~-----~~~G~~~~~v~~~~K~G~~~vlDr~tG~~i 338 (527)
T TIGR03075 308 L-----KKDGKPRKLLAHADRNGFFYVLDRTNGKLL 338 (527)
T ss_pred e-----ccCCcEEEEEEEeCCCceEEEEECCCCcee
Confidence 3 34555 7889999999999999998875
No 364
>PF14783 BBS2_Mid: Ciliary BBSome complex subunit 2, middle region
Probab=97.53 E-value=0.014 Score=40.68 Aligned_cols=85 Identities=16% Similarity=0.155 Sum_probs=59.0
Q ss_pred eEEEEeec---cccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEE
Q 036605 24 YSCLACGF---VGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEM 100 (340)
Q Consensus 24 v~~l~~sp---~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~w 100 (340)
|++|++.. +|. .-|++|+.|..|++|+ ..+.+..+. ..+.|++++-... ..++.+-.+|+|-+|
T Consensus 2 V~al~~~d~d~dg~--------~eLlvGs~D~~IRvf~--~~e~~~Ei~--e~~~v~~L~~~~~-~~F~Y~l~NGTVGvY 68 (111)
T PF14783_consen 2 VTALCLFDFDGDGE--------NELLVGSDDFEIRVFK--GDEIVAEIT--ETDKVTSLCSLGG-GRFAYALANGTVGVY 68 (111)
T ss_pred eeEEEEEecCCCCc--------ceEEEecCCcEEEEEe--CCcEEEEEe--cccceEEEEEcCC-CEEEEEecCCEEEEE
Confidence 56777754 331 2799999999999998 446777777 4567888887754 678888999999999
Q ss_pred eCCCCeEEEEeecCCCCeeEEEEc
Q 036605 101 KSEMGEVIREFKASEKPISSSAFL 124 (340)
Q Consensus 101 d~~~~~~~~~~~~~~~~i~~l~~~ 124 (340)
+- ...+...+.... +.++++.
T Consensus 69 ~~--~~RlWRiKSK~~-~~~~~~~ 89 (111)
T PF14783_consen 69 DR--SQRLWRIKSKNQ-VTSMAFY 89 (111)
T ss_pred eC--cceeeeeccCCC-eEEEEEE
Confidence 75 334455554333 4555443
No 365
>PF04053 Coatomer_WDAD: Coatomer WD associated region ; InterPro: IPR006692 Proteins synthesised on the ribosome and processed in the endoplasmic reticulum are transported from the Golgi apparatus to the trans-Golgi network (TGN), and from there via small carrier vesicles to their final destination compartment. This traffic is bidirectional, to ensure that proteins required to form vesicles are recycled. Vesicles have specific coat proteins (such as clathrin or coatomer) that are important for cargo selection and direction of transfer []. While clathrin mediates endocytic protein transport, and transport from ER to Golgi, coatomers primarily mediate intra-Golgi transport, as well as the reverse Golgi to ER transport of dilysine-tagged proteins []. For example, the coatomer COP1 (coat protein complex 1) is responsible for reverse transport of recycled proteins from Golgi and pre-Golgi compartments back to the ER, while COPII buds vesicles from the ER to the Golgi []. Coatomers reversibly associate with Golgi (non-clathrin-coated) vesicles to mediate protein transport and for budding from Golgi membranes []. Activated small guanine triphosphatases (GTPases) attract coat proteins to specific membrane export sites, thereby linking coatomers to export cargos. As coat proteins polymerise, vesicles are formed and budded from membrane-bound organelles. Coatomer complexes also influence Golgi structural integrity, as well as the processing, activity, and endocytic recycling of LDL receptors. In mammals, coatomer complexes can only be recruited by membranes associated to ADP-ribosylation factors (ARFs), which are small GTP-binding proteins. Coatomer complexes are hetero-oligomers composed of at least an alpha, beta, beta', gamma, delta, epsilon and zeta subunits. This entry represents the WD-associated region found in coatomer subunits alpha, beta and beta' subunits. The alpha-subunit (RET1P) of the coatomer complex in Saccharomyces cerevisiae (Baker's yeast), participates in membrane transport between the endoplasmic reticulum and Golgi apparatus. The protein contains six WD-40 repeat motifs in its N-terminal region []. More information about these proteins can be found at Protein of the Month: Clathrin [].; GO: 0005198 structural molecule activity, 0006886 intracellular protein transport, 0016192 vesicle-mediated transport, 0030117 membrane coat; PDB: 3MKQ_B.
Probab=97.50 E-value=0.011 Score=52.71 Aligned_cols=182 Identities=14% Similarity=0.107 Sum_probs=90.4
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeC
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKS 102 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~ 102 (340)
.....+|++.++ +|+-..+++|.|+.--+.+....+.. +..+..+-. |..|...+.+ .|.+||+
T Consensus 70 ~g~~~vw~~~n~----------yAv~~~~~~I~I~kn~~~~~~k~i~~--~~~~~~If~---G~LL~~~~~~-~i~~yDw 133 (443)
T PF04053_consen 70 SGLSFVWSSRNR----------YAVLESSSTIKIYKNFKNEVVKSIKL--PFSVEKIFG---GNLLGVKSSD-FICFYDW 133 (443)
T ss_dssp E-SEEEE-TSSE----------EEEE-TTS-EEEEETTEE-TT-------SS-EEEEE----SSSEEEEETT-EEEEE-T
T ss_pred ceeEEEEecCcc----------EEEEECCCeEEEEEcCccccceEEcC--CcccceEEc---CcEEEEECCC-CEEEEEh
Confidence 345567777555 66666678888864222222223332 223444432 7777776555 8999999
Q ss_pred CCCeEEEEeecCCCCeeEEEEccCCCEEEEecC-cEEEEECCCC-----------ceeEEeecCCCCeEEEEECCCCCEE
Q 036605 103 EMGEVIREFKASEKPISSSAFLCEEKIFALASS-EVRILSLENG-----------EEVLKFSDDVGPLQYVSASDGAKII 170 (340)
Q Consensus 103 ~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~-~i~i~d~~~~-----------~~~~~~~~~~~~v~~~~~s~~~~~l 170 (340)
.+++.+..+... +|..+.|++++.+++..+. .+.+++.... ..+..+......|.+..|..+ -++
T Consensus 134 ~~~~~i~~i~v~--~vk~V~Ws~~g~~val~t~~~i~il~~~~~~~~~~~~~g~e~~f~~~~E~~~~IkSg~W~~d-~fi 210 (443)
T PF04053_consen 134 ETGKLIRRIDVS--AVKYVIWSDDGELVALVTKDSIYILKYNLEAVAAIPEEGVEDAFELIHEISERIKSGCWVED-CFI 210 (443)
T ss_dssp TT--EEEEESS---E-EEEEE-TTSSEEEEE-S-SEEEEEE-HHHHHHBTTTB-GGGEEEEEEE-S--SEEEEETT-EEE
T ss_pred hHcceeeEEecC--CCcEEEEECCCCEEEEEeCCeEEEEEecchhcccccccCchhceEEEEEecceeEEEEEEcC-EEE
Confidence 999999988743 4889999999999977544 4777664322 022333322567888999777 344
Q ss_pred EEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 171 ITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 171 ~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
++ .. +.++.+- .++.. ....+..+...... .+....++....|+.+..+.+..
T Consensus 211 Yt-T~--~~lkYl~----~Ge~~--~i~~ld~~~yllgy-----~~~~~~ly~~Dr~~~v~~~~ld~ 263 (443)
T PF04053_consen 211 YT-TS--NHLKYLV----NGETG--IIAHLDKPLYLLGY-----LPKENRLYLIDRDGNVISYELDL 263 (443)
T ss_dssp EE--T--TEEEEEE----TTEEE--EEEE-SS--EEEEE-----ETTTTEEEEE-TT--EEEEE--H
T ss_pred EE-cC--CeEEEEE----cCCcc--eEEEcCCceEEEEE-----EccCCEEEEEECCCCEEEEEECH
Confidence 44 44 3666632 22211 11112333333333 34456777788888888887654
No 366
>PF12894 Apc4_WD40: Anaphase-promoting complex subunit 4 WD40 domain
Probab=97.48 E-value=0.00033 Score=40.65 Aligned_cols=37 Identities=24% Similarity=0.346 Sum_probs=31.4
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMK 65 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~ 65 (340)
.....|.+++|+|... +||.|+.+|.|.+|.+ +++.+
T Consensus 9 ~l~~~v~~~~w~P~md---------LiA~~t~~g~v~v~Rl-~~qri 45 (47)
T PF12894_consen 9 NLPSRVSCMSWCPTMD---------LIALGTEDGEVLVYRL-NWQRI 45 (47)
T ss_pred CCCCcEEEEEECCCCC---------EEEEEECCCeEEEEEC-CCcCc
Confidence 3456899999999999 9999999999999998 55433
No 367
>PF04841 Vps16_N: Vps16, N-terminal region; InterPro: IPR006926 This protein forms part of the Class C vacuolar protein sorting (Vps) complex. Vps16 is essential for vacuolar protein sorting, which is essential for viability in plants, but not yeast []. The Class C Vps complex is required for SNARE-mediated membrane fusion at the lysosome-like yeast vacuole. It is thought to play essential roles in membrane docking and fusion at the Golgi-to-endosome and endosome-to-vacuole stages of transport []. The role of VPS16 in this complex is not known.; GO: 0006886 intracellular protein transport, 0005737 cytoplasm
Probab=97.34 E-value=0.049 Score=48.47 Aligned_cols=159 Identities=16% Similarity=0.143 Sum_probs=77.9
Q ss_pred CCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecC------CCCCCeEEE
Q 036605 6 DGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTG------RHPGGLAGL 79 (340)
Q Consensus 6 ~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~------~h~~~v~~v 79 (340)
+|.++..+.-. .+.+.++.|+.+.. |++-..||.+++||+. |+....+.. .....+...
T Consensus 69 sG~ll~~i~w~----~~~iv~~~wt~~e~----------LvvV~~dG~v~vy~~~-G~~~fsl~~~i~~~~v~e~~i~~~ 133 (410)
T PF04841_consen 69 SGKLLSSIPWD----SGRIVGMGWTDDEE----------LVVVQSDGTVRVYDLF-GEFQFSLGEEIEEEKVLECRIFAI 133 (410)
T ss_pred CCCEeEEEEEC----CCCEEEEEECCCCe----------EEEEEcCCEEEEEeCC-CceeechhhhccccCccccccccc
Confidence 46666555422 27899999998767 6677799999999986 333111110 011222222
Q ss_pred EEecCCCEEEEEeCCCcEEEEeCCCCeEE-EEeecCCCCeeE----------EEEccCCCEEEE--ecCcEEEEECCCCc
Q 036605 80 AFAKKGRSLHVVGTNGMASEMKSEMGEVI-REFKASEKPISS----------SAFLCEEKIFAL--ASSEVRILSLENGE 146 (340)
Q Consensus 80 ~~~~~~~~l~s~~~dg~i~~wd~~~~~~~-~~~~~~~~~i~~----------l~~~~~~~~l~~--~~~~i~i~d~~~~~ 146 (340)
.+..+|-.++ ..++.+.+.+-...... ..+..-...... ..++.+....+. .+..+.+.+-...+
T Consensus 134 ~~~~~GivvL--t~~~~~~~v~n~~~~~~~~~~~~~p~~~~~~~~~~~~~~i~~l~~~~~~~i~~~~g~~i~~i~~~~~~ 211 (410)
T PF04841_consen 134 WFYKNGIVVL--TGNNRFYVVNNIDEPVKLRRLPEIPGLWTKFHWWPSWTVIPLLSSDRVVEILLANGETIYIIDENSFK 211 (410)
T ss_pred ccCCCCEEEE--CCCCeEEEEeCccccchhhccccCCCcccccccccccccceEeecCcceEEEEecCCEEEEEEccccc
Confidence 3332342223 34444544432221111 111100000000 112222222111 22223333222111
Q ss_pred eeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 147 EVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 147 ~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
. + ...+++..|++||++++++.-.. +|.+.|...+
T Consensus 212 ~---i-~~~~~i~~iavSpng~~iAl~t~-~g~l~v~ssD 246 (410)
T PF04841_consen 212 Q---I-DSDGPIIKIAVSPNGKFIALFTD-SGNLWVVSSD 246 (410)
T ss_pred c---c-cCCCCeEEEEECCCCCEEEEEEC-CCCEEEEECc
Confidence 1 1 12368999999999999988766 8998888763
No 368
>PHA02713 hypothetical protein; Provisional
Probab=97.24 E-value=0.039 Score=51.26 Aligned_cols=61 Identities=11% Similarity=0.078 Sum_probs=33.4
Q ss_pred EEEEEcCC------CcEEEEEccCCeeEEEecCCCCCCe-EEEEEecCCCEEEEEeCCC-----cEEEEeCCCCe
Q 036605 44 LLALGTSN------GDILAVDVLTGEMKWKSTGRHPGGL-AGLAFAKKGRSLHVVGTNG-----MASEMKSEMGE 106 (340)
Q Consensus 44 ~l~~g~~d------g~i~i~d~~~~~~~~~~~~~h~~~v-~~v~~~~~~~~l~s~~~dg-----~i~~wd~~~~~ 106 (340)
++++|+.+ ..+..||..+.... .+..-....- .+++ .-+|+..+.||.++ .+..||+.+.+
T Consensus 306 IYviGG~~~~~~~~~~v~~Yd~~~n~W~-~~~~m~~~R~~~~~~-~~~g~IYviGG~~~~~~~~sve~Ydp~~~~ 378 (557)
T PHA02713 306 IIIAGGYNFNNPSLNKVYKINIENKIHV-ELPPMIKNRCRFSLA-VIDDTIYAIGGQNGTNVERTIECYTMGDDK 378 (557)
T ss_pred EEEEcCCCCCCCccceEEEEECCCCeEe-eCCCCcchhhceeEE-EECCEEEEECCcCCCCCCceEEEEECCCCe
Confidence 67777753 34778998877532 2221011111 1222 22566667777653 47889987654
No 369
>PF05694 SBP56: 56kDa selenium binding protein (SBP56); InterPro: IPR008826 This family consists of several eukaryotic selenium binding proteins as well as three sequences from archaea. The exact function of this protein is unknown although it is thought that SBP56 participates in late stages of intra-Golgi protein transport []. The Lotus japonicus homologue of SBP56, LjSBP is thought to have more than one physiological role and can be implicated in controlling the oxidation/reduction status of target proteins in vesicular Golgi transport [].; GO: 0008430 selenium binding; PDB: 2ECE_A.
Probab=97.24 E-value=0.12 Score=45.21 Aligned_cols=191 Identities=10% Similarity=0.036 Sum_probs=90.9
Q ss_pred EEEE-EcCCCcEEEEEccC----CeeEEEecC--CCC----CCeEEEEEecCCCEEEEE--eCC----CcEEEEeCCCCe
Q 036605 44 LLAL-GTSNGDILAVDVLT----GEMKWKSTG--RHP----GGLAGLAFAKKGRSLHVV--GTN----GMASEMKSEMGE 106 (340)
Q Consensus 44 ~l~~-g~~dg~i~i~d~~~----~~~~~~~~~--~h~----~~v~~v~~~~~~~~l~s~--~~d----g~i~~wd~~~~~ 106 (340)
+|++ |-..+.|+|+|+.+ .++.+.+.. .+. ..-..+..-|+|+.++++ +.+ |-+.++|-++.+
T Consensus 89 ~Li~PgL~SsrIyviD~~~dPr~P~l~KvIe~~ev~~k~g~s~PHT~Hclp~G~imIS~lGd~~G~g~Ggf~llD~~tf~ 168 (461)
T PF05694_consen 89 YLILPGLRSSRIYVIDTKTDPRKPRLHKVIEPEEVFEKTGLSRPHTVHCLPDGRIMISALGDADGNGPGGFVLLDGETFE 168 (461)
T ss_dssp EEEEEBTTT--EEEEE--S-TTS-EEEEEE-HHHHHHHH-EEEEEEEEE-SS--EEEEEEEETTS-S--EEEEE-TTT--
T ss_pred cEEeeeeccCcEEEEECCCCCCCCceEeeeCHHHHHhhcCCCCCceeeecCCccEEEEeccCCCCCCCCcEEEEcCcccc
Confidence 5555 44889999999873 334444432 010 112233335688888875 222 678899999888
Q ss_pred EEEEeecCCC---CeeEEEEccCCCEEEEec----------------------CcEEEEECCCCceeEEeecCC--CCeE
Q 036605 107 VIREFKASEK---PISSSAFLCEEKIFALAS----------------------SEVRILSLENGEEVLKFSDDV--GPLQ 159 (340)
Q Consensus 107 ~~~~~~~~~~---~i~~l~~~~~~~~l~~~~----------------------~~i~i~d~~~~~~~~~~~~~~--~~v~ 159 (340)
.+..+..... --+.+.+.|..+.+++.. +.+.+||+.+.+.++.+.--. ....
T Consensus 169 v~g~We~~~~~~~~gYDfw~qpr~nvMiSSeWg~P~~~~~Gf~~~d~~~~~yG~~l~vWD~~~r~~~Q~idLg~~g~~pL 248 (461)
T PF05694_consen 169 VKGRWEKDRGPQPFGYDFWYQPRHNVMISSEWGAPSMFEKGFNPEDLEAGKYGHSLHVWDWSTRKLLQTIDLGEEGQMPL 248 (461)
T ss_dssp EEEE--SB-TT------EEEETTTTEEEE-B---HHHHTT---TTTHHHH-S--EEEEEETTTTEEEEEEES-TTEEEEE
T ss_pred ccceeccCCCCCCCCCCeEEcCCCCEEEEeccCChhhcccCCChhHhhcccccCeEEEEECCCCcEeeEEecCCCCCceE
Confidence 8888765433 346778888888887722 239999999999998885433 2355
Q ss_pred EEEE--CCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeec------------------CCCeeeeeecCCCCCCCC
Q 036605 160 YVSA--SDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMR------------------HSPVAIDCKNSPNGEDGT 219 (340)
Q Consensus 160 ~~~~--s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~------------------~~~~~~~~~~~~~~~~~~ 219 (340)
.+.| .|+..+-++++.-...|..|--. ..++....-...+. -++.+.++ .. +.|.+
T Consensus 249 EvRflH~P~~~~gFvg~aLss~i~~~~k~-~~g~W~a~kVi~ip~~~v~~~~lp~ml~~~~~~P~LitDI--~i-SlDDr 324 (461)
T PF05694_consen 249 EVRFLHDPDANYGFVGCALSSSIWRFYKD-DDGEWAAEKVIDIPAKKVEGWILPEMLKPFGAVPPLITDI--LI-SLDDR 324 (461)
T ss_dssp EEEE-SSTT--EEEEEEE--EEEEEEEE--ETTEEEEEEEEEE--EE--SS---GGGGGG-EE------E--EE--TTS-
T ss_pred EEEecCCCCccceEEEEeccceEEEEEEc-CCCCeeeeEEEECCCcccCcccccccccccccCCCceEeE--EE-ccCCC
Confidence 6777 44455544433325555544321 12211111111111 02334443 22 66777
Q ss_pred EEEEEe-CCCcEEEEECCCC
Q 036605 220 VILAVA-ESGVAYSWDLKTV 238 (340)
Q Consensus 220 ~l~~~s-~dg~i~vwd~~~~ 238 (340)
+|...+ .+|.|+.||+...
T Consensus 325 fLYvs~W~~GdvrqYDISDP 344 (461)
T PF05694_consen 325 FLYVSNWLHGDVRQYDISDP 344 (461)
T ss_dssp EEEEEETTTTEEEEEE-SST
T ss_pred EEEEEcccCCcEEEEecCCC
Confidence 776655 5899999999763
No 370
>KOG2395 consensus Protein involved in vacuole import and degradation [Intracellular trafficking, secretion, and vesicular transport]
Probab=97.20 E-value=0.016 Score=51.22 Aligned_cols=142 Identities=11% Similarity=0.071 Sum_probs=99.1
Q ss_pred ceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCC--E-----EEEEeCCCcEEEEeCCCCeE--EEEee
Q 036605 42 TLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGR--S-----LHVVGTNGMASEMKSEMGEV--IREFK 112 (340)
Q Consensus 42 ~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~--~-----l~s~~~dg~i~~wd~~~~~~--~~~~~ 112 (340)
..+|..+.....++-.|++.|+.+..+.- |.. |+-+.+.|+.+ . -+.|-.|..|.-||++-... +....
T Consensus 346 nlil~~~~~~~~l~klDIE~GKIVeEWk~-~~d-i~mv~~t~d~K~~Ql~~e~TlvGLs~n~vfriDpRv~~~~kl~~~q 423 (644)
T KOG2395|consen 346 NLILMDGGEQDKLYKLDIERGKIVEEWKF-EDD-INMVDITPDFKFAQLTSEQTLVGLSDNSVFRIDPRVQGKNKLAVVQ 423 (644)
T ss_pred ceEeeCCCCcCcceeeecccceeeeEeec-cCC-cceeeccCCcchhcccccccEEeecCCceEEecccccCcceeeeee
Confidence 34555666777899999999999888875 554 78888887653 2 24466778999999874322 11111
Q ss_pred c----CCCCeeEEEEccCCCEEEE-ecCcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccC
Q 036605 113 A----SEKPISSSAFLCEEKIFAL-ASSEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDI 187 (340)
Q Consensus 113 ~----~~~~i~~l~~~~~~~~l~~-~~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~ 187 (340)
+ ......|.+-..+|.+++. -+++|++||--....-..+++-..+|..+..+.+|++|++++ +.++.+.++..
T Consensus 424 ~kqy~~k~nFsc~aTT~sG~IvvgS~~GdIRLYdri~~~AKTAlPgLG~~I~hVdvtadGKwil~Tc--~tyLlLi~t~~ 501 (644)
T KOG2395|consen 424 SKQYSTKNNFSCFATTESGYIVVGSLKGDIRLYDRIGRRAKTALPGLGDAIKHVDVTADGKWILATC--KTYLLLIDTLI 501 (644)
T ss_pred ccccccccccceeeecCCceEEEeecCCcEEeehhhhhhhhhcccccCCceeeEEeeccCcEEEEec--ccEEEEEEEec
Confidence 1 2334678888888866543 566799999633333345677889999999999999999854 57888887743
No 371
>PF00780 CNH: CNH domain; InterPro: IPR001180 Based on sequence similarities a domain of homology has been identified in the following proteins []: Citron and Citron kinase. These two proteins interact with the GTP-bound forms of the small GTPases Rho and Rac but not with Cdc42. Myotonic dystrophy kinase-related Cdc42-binding kinase (MRCKalpha). This serine/threonine kinase interacts with the GTP-bound form of the small GTPase Cdc42 and to a lesser extent with that of Rac. NCK Interacting Kinase (NIK), a serine/threonine protein kinase. ROM-1 and ROM-2, from yeast. These proteins are GDP/GTP exchange proteins (GEPs) for the small GTP binding protein Rho1. This domain, called the citron homology domain, is often found after cysteine rich and pleckstrin homology (PH) domains at the C-terminal end of the proteins []. It acts as a regulatory domain and could be involved in macromolecular interactions [, ].; GO: 0005083 small GTPase regulator activity
Probab=97.19 E-value=0.06 Score=45.14 Aligned_cols=148 Identities=16% Similarity=0.189 Sum_probs=85.7
Q ss_pred cCCCEEEEEeCCCcEEEEeCC-CCeEEEEeecCCCCeeEEEEccCCCEEEE-ecCcEEEEECCCCceeEEe---------
Q 036605 83 KKGRSLHVVGTNGMASEMKSE-MGEVIREFKASEKPISSSAFLCEEKIFAL-ASSEVRILSLENGEEVLKF--------- 151 (340)
Q Consensus 83 ~~~~~l~s~~~dg~i~~wd~~-~~~~~~~~~~~~~~i~~l~~~~~~~~l~~-~~~~i~i~d~~~~~~~~~~--------- 151 (340)
..++.|+.|..+| +.+++.. ........ +...|..+.+.|+-+.+++ +++.++++++..-......
T Consensus 5 ~~~~~L~vGt~~G-l~~~~~~~~~~~~~i~--~~~~I~ql~vl~~~~~llvLsd~~l~~~~L~~l~~~~~~~~~~~~~~~ 81 (275)
T PF00780_consen 5 SWGDRLLVGTEDG-LYVYDLSDPSKPTRIL--KLSSITQLSVLPELNLLLVLSDGQLYVYDLDSLEPVSTSAPLAFPKSR 81 (275)
T ss_pred cCCCEEEEEECCC-EEEEEecCCccceeEe--ecceEEEEEEecccCEEEEEcCCccEEEEchhhccccccccccccccc
Confidence 3578899998888 8999883 23322222 2334999999998776655 7788999998764433210
Q ss_pred -----ecCCCCeEEEE--ECCCCCEEEEEEcCCCeEEEEEccCCCCCc-cCCceeeecCCCeeeeeecCCCCCCCCEEEE
Q 036605 152 -----SDDVGPLQYVS--ASDGAKIIITAGYGEKHLQVWRCDISSKTV-NKGPALSMRHSPVAIDCKNSPNGEDGTVILA 223 (340)
Q Consensus 152 -----~~~~~~v~~~~--~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~ 223 (340)
......+...+ -...+...+..+. .+.|.+|.+....... .....+.+...+..+.+ . +..++.
T Consensus 82 ~~~~~~~~~~~v~~f~~~~~~~~~~~L~va~-kk~i~i~~~~~~~~~f~~~~ke~~lp~~~~~i~~-----~--~~~i~v 153 (275)
T PF00780_consen 82 SLPTKLPETKGVSFFAVNGGHEGSRRLCVAV-KKKILIYEWNDPRNSFSKLLKEISLPDPPSSIAF-----L--GNKICV 153 (275)
T ss_pred cccccccccCCeeEEeeccccccceEEEEEE-CCEEEEEEEECCcccccceeEEEEcCCCcEEEEE-----e--CCEEEE
Confidence 11122344444 1233334444455 6799999985321221 12223333444444444 2 456777
Q ss_pred EeCCCcEEEEECCCCCccC
Q 036605 224 VAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 224 ~s~dg~i~vwd~~~~~~~~ 242 (340)
|..++ ..+.|+.++...+
T Consensus 154 ~~~~~-f~~idl~~~~~~~ 171 (275)
T PF00780_consen 154 GTSKG-FYLIDLNTGSPSE 171 (275)
T ss_pred EeCCc-eEEEecCCCCceE
Confidence 77666 8889988654443
No 372
>PF04841 Vps16_N: Vps16, N-terminal region; InterPro: IPR006926 This protein forms part of the Class C vacuolar protein sorting (Vps) complex. Vps16 is essential for vacuolar protein sorting, which is essential for viability in plants, but not yeast []. The Class C Vps complex is required for SNARE-mediated membrane fusion at the lysosome-like yeast vacuole. It is thought to play essential roles in membrane docking and fusion at the Golgi-to-endosome and endosome-to-vacuole stages of transport []. The role of VPS16 in this complex is not known.; GO: 0006886 intracellular protein transport, 0005737 cytoplasm
Probab=97.19 E-value=0.15 Score=45.47 Aligned_cols=168 Identities=13% Similarity=0.090 Sum_probs=89.3
Q ss_pred cEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEe-------ecCCCCeeEEEEcc
Q 036605 53 DILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREF-------KASEKPISSSAFLC 125 (340)
Q Consensus 53 ~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~-------~~~~~~i~~l~~~~ 125 (340)
.|.||+.. |+.+.++.- -.+.|.++.|+.+ ..|+....||.++++|+. |+....+ ......+....+..
T Consensus 62 ~I~iys~s-G~ll~~i~w-~~~~iv~~~wt~~-e~LvvV~~dG~v~vy~~~-G~~~fsl~~~i~~~~v~e~~i~~~~~~~ 137 (410)
T PF04841_consen 62 SIQIYSSS-GKLLSSIPW-DSGRIVGMGWTDD-EELVVVQSDGTVRVYDLF-GEFQFSLGEEIEEEKVLECRIFAIWFYK 137 (410)
T ss_pred EEEEECCC-CCEeEEEEE-CCCCEEEEEECCC-CeEEEEEcCCEEEEEeCC-CceeechhhhccccCcccccccccccCC
Confidence 48899854 556666655 2389999999874 456667899999999986 3331111 11111222334444
Q ss_pred CCCEEEEecCcEEEEECCCCc-eeEEe---ec-------CCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccC
Q 036605 126 EEKIFALASSEVRILSLENGE-EVLKF---SD-------DVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNK 194 (340)
Q Consensus 126 ~~~~l~~~~~~i~i~d~~~~~-~~~~~---~~-------~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~ 194 (340)
+|-.+++.++.+.+..--... ..+.+ .. +.....-..++.+....+.... ++.+.+.+-. ....
T Consensus 138 ~GivvLt~~~~~~~v~n~~~~~~~~~~~~~p~~~~~~~~~~~~~~i~~l~~~~~~~i~~~~-g~~i~~i~~~--~~~~-- 212 (410)
T PF04841_consen 138 NGIVVLTGNNRFYVVNNIDEPVKLRRLPEIPGLWTKFHWWPSWTVIPLLSSDRVVEILLAN-GETIYIIDEN--SFKQ-- 212 (410)
T ss_pred CCEEEECCCCeEEEEeCccccchhhccccCCCcccccccccccccceEeecCcceEEEEec-CCEEEEEEcc--cccc--
Confidence 665556666665444322211 11111 10 1111011234555555555455 5666644421 1111
Q ss_pred CceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 195 GPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 195 ~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
.. ...+-..+.+ +|++.+++.-..+|.+.+.+..-
T Consensus 213 -i~--~~~~i~~iav-----Spng~~iAl~t~~g~l~v~ssDf 247 (410)
T PF04841_consen 213 -ID--SDGPIIKIAV-----SPNGKFIALFTDSGNLWVVSSDF 247 (410)
T ss_pred -cc--CCCCeEEEEE-----CCCCCEEEEEECCCCEEEEECcc
Confidence 10 0112223334 89999999999999998886543
No 373
>KOG4640 consensus Anaphase-promoting complex (APC), subunit 4 [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=97.12 E-value=0.0036 Score=56.16 Aligned_cols=92 Identities=11% Similarity=0.133 Sum_probs=74.5
Q ss_pred CCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCee-EEEEccCCCEEEE--ecCcEEEEECCCCceeE
Q 036605 73 PGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPIS-SSAFLCEEKIFAL--ASSEVRILSLENGEEVL 149 (340)
Q Consensus 73 ~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~-~l~~~~~~~~l~~--~~~~i~i~d~~~~~~~~ 149 (340)
...|.-+.|+|.-..+|.+..+|.|.+.-+. .+.+..+..+...++ +++|.|||+.+++ .+|+|++.|.+++..+.
T Consensus 20 ~~~i~~~ewnP~~dLiA~~t~~gelli~R~n-~qRlwtip~p~~~v~~sL~W~~DGkllaVg~kdG~I~L~Dve~~~~l~ 98 (665)
T KOG4640|consen 20 PINIKRIEWNPKMDLIATRTEKGELLIHRLN-WQRLWTIPIPGENVTASLCWRPDGKLLAVGFKDGTIRLHDVEKGGRLV 98 (665)
T ss_pred ccceEEEEEcCccchhheeccCCcEEEEEec-cceeEeccCCCCccceeeeecCCCCEEEEEecCCeEEEEEccCCCcee
Confidence 3467889999999999999999999988877 667777776666666 9999999999988 57779999999998776
Q ss_pred Ee-ecCCCCeEEEEECC
Q 036605 150 KF-SDDVGPLQYVSASD 165 (340)
Q Consensus 150 ~~-~~~~~~v~~~~~s~ 165 (340)
.+ -....+|.++.|++
T Consensus 99 ~~~~s~e~~is~~~w~~ 115 (665)
T KOG4640|consen 99 SFLFSVETDISKGIWDR 115 (665)
T ss_pred ccccccccchheeeccc
Confidence 63 22346778888863
No 374
>PF14783 BBS2_Mid: Ciliary BBSome complex subunit 2, middle region
Probab=97.09 E-value=0.049 Score=37.99 Aligned_cols=99 Identities=12% Similarity=0.151 Sum_probs=61.0
Q ss_pred eEEEEEec---CC-CEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE-ecCcEEEEECCCCceeEE
Q 036605 76 LAGLAFAK---KG-RSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL-ASSEVRILSLENGEEVLK 150 (340)
Q Consensus 76 v~~v~~~~---~~-~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~-~~~~i~i~d~~~~~~~~~ 150 (340)
|+++++.. +| +.|+.|+.|..|++|+- .+.+.++.. ...+.++.-...+++.+. ..++|-+|+-.. .+-.
T Consensus 2 V~al~~~d~d~dg~~eLlvGs~D~~IRvf~~--~e~~~Ei~e-~~~v~~L~~~~~~~F~Y~l~NGTVGvY~~~~--RlWR 76 (111)
T PF14783_consen 2 VTALCLFDFDGDGENELLVGSDDFEIRVFKG--DEIVAEITE-TDKVTSLCSLGGGRFAYALANGTVGVYDRSQ--RLWR 76 (111)
T ss_pred eeEEEEEecCCCCcceEEEecCCcEEEEEeC--CcEEEEEec-ccceEEEEEcCCCEEEEEecCCEEEEEeCcc--eeee
Confidence 56666654 33 47999999999999974 356666664 456778877777766644 778888887532 2333
Q ss_pred eecCCCCeEEEEE-C--CCCC-EEEEEEcCCCeEE
Q 036605 151 FSDDVGPLQYVSA-S--DGAK-IIITAGYGEKHLQ 181 (340)
Q Consensus 151 ~~~~~~~v~~~~~-s--~~~~-~l~s~~~~d~~i~ 181 (340)
.+... .+.++.+ . .||. -|+++-. +|.|-
T Consensus 77 iKSK~-~~~~~~~~D~~gdG~~eLI~Gws-nGkve 109 (111)
T PF14783_consen 77 IKSKN-QVTSMAFYDINGDGVPELIVGWS-NGKVE 109 (111)
T ss_pred eccCC-CeEEEEEEcCCCCCceEEEEEec-CCeEE
Confidence 33222 3455544 2 2333 3555444 77764
No 375
>KOG2079 consensus Vacuolar assembly/sorting protein VPS8 [Intracellular trafficking, secretion, and vesicular transport]
Probab=97.06 E-value=0.0024 Score=60.67 Aligned_cols=98 Identities=15% Similarity=0.243 Sum_probs=72.7
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecC-CCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEE-
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTG-RHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSS- 121 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~-~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l- 121 (340)
.++.|++.|.+...|.... .-+-..+ .-.++|++++|+.+|..++.|-.+|.|.+||+..++.++.+..+..+...+
T Consensus 101 ~ivi~Ts~ghvl~~d~~~n-L~~~~~ne~v~~~Vtsvafn~dg~~l~~G~~~G~V~v~D~~~~k~l~~i~e~~ap~t~vi 179 (1206)
T KOG2079|consen 101 PIVIGTSHGHVLLSDMTGN-LGPLHQNERVQGPVTSVAFNQDGSLLLAGLGDGHVTVWDMHRAKILKVITEHGAPVTGVI 179 (1206)
T ss_pred eEEEEcCchhhhhhhhhcc-cchhhcCCccCCcceeeEecCCCceeccccCCCcEEEEEccCCcceeeeeecCCccceEE
Confidence 6888999999998887653 2211111 256799999999999999999999999999999999998888777665544
Q ss_pred --EEccCCCEEEEecCcEEEEEC
Q 036605 122 --AFLCEEKIFALASSEVRILSL 142 (340)
Q Consensus 122 --~~~~~~~~l~~~~~~i~i~d~ 142 (340)
.+..++..+++++..=.+|.+
T Consensus 180 ~v~~t~~nS~llt~D~~Gsf~~l 202 (1206)
T KOG2079|consen 180 FVGRTSQNSKLLTSDTGGSFWKL 202 (1206)
T ss_pred EEEEeCCCcEEEEccCCCceEEE
Confidence 344555566776655446654
No 376
>PF08596 Lgl_C: Lethal giant larvae(Lgl) like, C-terminal; InterPro: IPR013905 The Lethal giant larvae (Lgl) tumour suppressor protein is conserved from yeast to mammals. The Lgl protein functions in cell polarity, at least in part, by regulating SNARE-mediated membrane delivery events at the cell surface []. The N-terminal half of Lgl members contains WD40 repeats (see IPR001680 from INTERPRO), while the C-terminal half appears specific to the protein []. ; PDB: 2OAJ_A.
Probab=96.96 E-value=0.21 Score=44.14 Aligned_cols=200 Identities=13% Similarity=0.135 Sum_probs=104.8
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeE-------------------------------------
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMK------------------------------------- 65 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~------------------------------------- 65 (340)
.|+.+.|+++.. -|++|...|.|.+|.....+..
T Consensus 3 ~v~~vs~a~~t~---------Elav~~~~GeVv~~k~~~n~~~~~~~~~~~~~~~~~~~~~~~~~~~l~di~~r~~~~~~ 73 (395)
T PF08596_consen 3 SVTHVSFAPETL---------ELAVGLESGEVVLFKFGKNQNYGNREQPPDLDYNFRRFSLNNSPGKLTDISDRAPPSLK 73 (395)
T ss_dssp -EEEEEEETTTT---------EEEEEETTS-EEEEEEEE------------------S--GGGSS-SEEE-GGG--TT-S
T ss_pred eEEEEEecCCCc---------eEEEEccCCcEEEEEcccCCCCCccCCCcccCcccccccccCCCcceEEehhhCCcccc
Confidence 688999998875 5999999999999865322111
Q ss_pred ------EEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEe--ec------CCCCeeEEEEc-----cC
Q 036605 66 ------WKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREF--KA------SEKPISSSAFL-----CE 126 (340)
Q Consensus 66 ------~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~--~~------~~~~i~~l~~~-----~~ 126 (340)
.-+.. ..++|++++.+ |-.+++.|..+|.+.+.|++....+..- .. ....++++.|. .|
T Consensus 74 ~gf~P~~l~~~-~~g~vtal~~S-~iGFvaigy~~G~l~viD~RGPavI~~~~i~~~~~~~~~~~~vt~ieF~vm~~~~D 151 (395)
T PF08596_consen 74 EGFLPLTLLDA-KQGPVTALKNS-DIGFVAIGYESGSLVVIDLRGPAVIYNENIRESFLSKSSSSYVTSIEFSVMTLGGD 151 (395)
T ss_dssp EEEEEEEEE----S-SEEEEEE--BTSEEEEEETTSEEEEEETTTTEEEEEEEGGG--T-SS----EEEEEEEEEE-TTS
T ss_pred cccCchhheec-cCCcEeEEecC-CCcEEEEEecCCcEEEEECCCCeEEeeccccccccccccccCeeEEEEEEEecCCC
Confidence 01112 45789999987 5669999999999999999887776652 22 22356777776 23
Q ss_pred C---CEEEE--ecCcEEEEECC--C-CceeEEe----ecCCCCeEEEE-ECCC---------------------CCEEEE
Q 036605 127 E---KIFAL--ASSEVRILSLE--N-GEEVLKF----SDDVGPLQYVS-ASDG---------------------AKIIIT 172 (340)
Q Consensus 127 ~---~~l~~--~~~~i~i~d~~--~-~~~~~~~----~~~~~~v~~~~-~s~~---------------------~~~l~s 172 (340)
+ ..+++ ..+.+.+|.+- . +.-...+ ..+.+++..+. |+.+ ..+++.
T Consensus 152 ~ySSi~L~vGTn~G~v~~fkIlp~~~g~f~v~~~~~~~~~~~~i~~I~~i~~~~G~~a~At~~~~~~l~~g~~i~g~vVv 231 (395)
T PF08596_consen 152 GYSSICLLVGTNSGNVLTFKILPSSNGRFSVQFAGATTNHDSPILSIIPINADTGESALATISAMQGLSKGISIPGYVVV 231 (395)
T ss_dssp SSEEEEEEEEETTSEEEEEEEEE-GGG-EEEEEEEEE--SS----EEEEEETTT--B-B-BHHHHHGGGGT----EEEEE
T ss_pred cccceEEEEEeCCCCEEEEEEecCCCCceEEEEeeccccCCCceEEEEEEECCCCCcccCchhHhhccccCCCcCcEEEE
Confidence 3 23333 33446666553 1 2111111 24556666555 3211 124444
Q ss_pred EEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCC----CCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 173 AGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPN----GEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 173 ~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~----~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
.. +..++|+... +.+.... ....+ ..... +.+. ...+..|++-..+|.|++|.+...+++.
T Consensus 232 -vS-e~~irv~~~~--~~k~~~K---~~~~~-~~~~~-~~vv~~~~~~~~~~Lv~l~~~G~i~i~SLP~Lkei~ 296 (395)
T PF08596_consen 232 -VS-ESDIRVFKPP--KSKGAHK---SFDDP-FLCSS-ASVVPTISRNGGYCLVCLFNNGSIRIYSLPSLKEIK 296 (395)
T ss_dssp -E--SSEEEEE-TT-----EEEE---E-SS--EEEEE-EEEEEEE-EEEEEEEEEEETTSEEEEEETTT--EEE
T ss_pred -Ec-ccceEEEeCC--CCcccce---eeccc-cccce-EEEEeecccCCceEEEEEECCCcEEEEECCCchHhh
Confidence 44 6899999873 3221111 11111 11111 0110 2356778999999999999998766554
No 377
>PRK13616 lipoprotein LpqB; Provisional
Probab=96.92 E-value=0.054 Score=50.41 Aligned_cols=102 Identities=9% Similarity=0.076 Sum_probs=63.5
Q ss_pred CCeEEEEEecCCCEEEEEe------CCC--cEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEe-cCc--------
Q 036605 74 GGLAGLAFAKKGRSLHVVG------TNG--MASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALA-SSE-------- 136 (340)
Q Consensus 74 ~~v~~v~~~~~~~~l~s~~------~dg--~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~-~~~-------- 136 (340)
..+...+++|+|+.++... .|. .|.+++. .+.. ..+.... ..+.-.|+|+|..+.+. ++.
T Consensus 350 ~~vsspaiSpdG~~vA~v~~~~~~~~d~~s~Lwv~~~-gg~~-~~lt~g~-~~t~PsWspDG~~lw~v~dg~~~~~v~~~ 426 (591)
T PRK13616 350 GNITSAALSRSGRQVAAVVTLGRGAPDPASSLWVGPL-GGVA-VQVLEGH-SLTRPSWSLDADAVWVVVDGNTVVRVIRD 426 (591)
T ss_pred cCcccceECCCCCEEEEEEeecCCCCCcceEEEEEeC-CCcc-eeeecCC-CCCCceECCCCCceEEEecCcceEEEecc
Confidence 3678899999999877655 243 4555554 2332 3333222 37888999998866553 331
Q ss_pred -----EEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEE
Q 036605 137 -----VRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVW 183 (340)
Q Consensus 137 -----i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iw 183 (340)
+++.++..++... .....|..+.|||||..++... ++.|.+=
T Consensus 427 ~~~gql~~~~vd~ge~~~---~~~g~Issl~wSpDG~RiA~i~--~g~v~Va 473 (591)
T PRK13616 427 PATGQLARTPVDASAVAS---RVPGPISELQLSRDGVRAAMII--GGKVYLA 473 (591)
T ss_pred CCCceEEEEeccCchhhh---ccCCCcCeEEECCCCCEEEEEE--CCEEEEE
Confidence 3333443332211 2345799999999999998855 4677763
No 378
>KOG2395 consensus Protein involved in vacuole import and degradation [Intracellular trafficking, secretion, and vesicular transport]
Probab=96.91 E-value=0.019 Score=50.74 Aligned_cols=132 Identities=11% Similarity=0.068 Sum_probs=85.3
Q ss_pred cCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCee-EEEecCCCC----CCeE
Q 036605 3 STNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEM-KWKSTGRHP----GGLA 77 (340)
Q Consensus 3 d~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~-~~~~~~~h~----~~v~ 77 (340)
|.++|+++.+|+ -+ ..|+.+.+.|+.+-.+.- ...-++|-.+..|.-||.+-... .......|. ....
T Consensus 362 DIE~GKIVeEWk----~~-~di~mv~~t~d~K~~Ql~--~e~TlvGLs~n~vfriDpRv~~~~kl~~~q~kqy~~k~nFs 434 (644)
T KOG2395|consen 362 DIERGKIVEEWK----FE-DDINMVDITPDFKFAQLT--SEQTLVGLSDNSVFRIDPRVQGKNKLAVVQSKQYSTKNNFS 434 (644)
T ss_pred ecccceeeeEee----cc-CCcceeeccCCcchhccc--ccccEEeecCCceEEecccccCcceeeeeeccccccccccc
Confidence 678999999998 23 338888899887511111 11234677788899999763321 111111121 2334
Q ss_pred EEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE-ecCcEEEEEC
Q 036605 78 GLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL-ASSEVRILSL 142 (340)
Q Consensus 78 ~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~-~~~~i~i~d~ 142 (340)
|.+-. ...+++.||.+|.|++||--..+...-+.+-..+|..|..+.+|++++. +...+.+.++
T Consensus 435 c~aTT-~sG~IvvgS~~GdIRLYdri~~~AKTAlPgLG~~I~hVdvtadGKwil~Tc~tyLlLi~t 499 (644)
T KOG2395|consen 435 CFATT-ESGYIVVGSLKGDIRLYDRIGRRAKTALPGLGDAIKHVDVTADGKWILATCKTYLLLIDT 499 (644)
T ss_pred eeeec-CCceEEEeecCCcEEeehhhhhhhhhcccccCCceeeEEeeccCcEEEEecccEEEEEEE
Confidence 44433 3448899999999999997333333447777889999999999999865 5555666665
No 379
>PF14870 PSII_BNR: Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=96.90 E-value=0.21 Score=42.18 Aligned_cols=150 Identities=17% Similarity=0.203 Sum_probs=80.4
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEE-EecCCCCCCeEEEEEecCCCEEEEEeCCCcEE
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKW-KSTGRHPGGLAGLAFAKKGRSLHVVGTNGMAS 98 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~-~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~ 98 (340)
....+..+.-+++|+ +++++.......-|| .|+..+ .....-...|..+.|.|++...+. ...|.|+
T Consensus 143 ~~gs~~~~~r~~dG~---------~vavs~~G~~~~s~~--~G~~~w~~~~r~~~~riq~~gf~~~~~lw~~-~~Gg~~~ 210 (302)
T PF14870_consen 143 TSGSINDITRSSDGR---------YVAVSSRGNFYSSWD--PGQTTWQPHNRNSSRRIQSMGFSPDGNLWML-ARGGQIQ 210 (302)
T ss_dssp ----EEEEEE-TTS----------EEEEETTSSEEEEE---TT-SS-EEEE--SSS-EEEEEE-TTS-EEEE-ETTTEEE
T ss_pred CcceeEeEEECCCCc---------EEEEECcccEEEEec--CCCccceEEccCccceehhceecCCCCEEEE-eCCcEEE
Confidence 346678888889999 777776555555676 343111 111114578999999999776554 5888888
Q ss_pred EEe-CCCCeEEEE----eecCCCCeeEEEEccCCCEEEEecCcEEEEECCCCceeEEee---cCCCCeEEEEECCCCCEE
Q 036605 99 EMK-SEMGEVIRE----FKASEKPISSSAFLCEEKIFALASSEVRILSLENGEEVLKFS---DDVGPLQYVSASDGAKII 170 (340)
Q Consensus 99 ~wd-~~~~~~~~~----~~~~~~~i~~l~~~~~~~~l~~~~~~i~i~d~~~~~~~~~~~---~~~~~v~~~~~s~~~~~l 170 (340)
.=+ ....+.... .......+..+++.+++...+++++-..+.....|+.-.+.. .-......+.|.++.+-+
T Consensus 211 ~s~~~~~~~~w~~~~~~~~~~~~~~ld~a~~~~~~~wa~gg~G~l~~S~DgGktW~~~~~~~~~~~n~~~i~f~~~~~gf 290 (302)
T PF14870_consen 211 FSDDPDDGETWSEPIIPIKTNGYGILDLAYRPPNEIWAVGGSGTLLVSTDGGKTWQKDRVGENVPSNLYRIVFVNPDKGF 290 (302)
T ss_dssp EEE-TTEEEEE---B-TTSS--S-EEEEEESSSS-EEEEESTT-EEEESSTTSS-EE-GGGTTSSS---EEEEEETTEEE
T ss_pred EccCCCCccccccccCCcccCceeeEEEEecCCCCEEEEeCCccEEEeCCCCccceECccccCCCCceEEEEEcCCCceE
Confidence 877 222222221 111223478899999988888877666666777775544432 234567888887666666
Q ss_pred EEEEcCCCeEEEE
Q 036605 171 ITAGYGEKHLQVW 183 (340)
Q Consensus 171 ~s~~~~d~~i~iw 183 (340)
+. +. +|.|--|
T Consensus 291 ~l-G~-~G~ll~~ 301 (302)
T PF14870_consen 291 VL-GQ-DGVLLRY 301 (302)
T ss_dssp EE--S-TTEEEEE
T ss_pred EE-CC-CcEEEEe
Confidence 66 56 7776544
No 380
>TIGR03074 PQQ_membr_DH membrane-bound PQQ-dependent dehydrogenase, glucose/quinate/shikimate family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Members of this family have several predicted transmembrane helices in the N-terminal region, and include the quinoprotein glucose dehydrogenase (EC 1.1.5.2) of Escherichia coli and the quinate/shikimate dehydrogenase of Acinetobacter sp. ADP1 (EC 1.1.99.25). Sequences closely related except for the absense of the N-terminal hydrophobic region, scoring in the gray zone between the trusted and noise cutoffs, include PQQ-dependent glycerol (EC 1.1.99.22) and and other polyol (sugar alcohol) dehydrogenases.
Probab=96.89 E-value=0.46 Score=45.78 Aligned_cols=69 Identities=20% Similarity=0.386 Sum_probs=50.8
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCC-------CeEEEEEec----------------CCCEEEEEeCCCcEEEE
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPG-------GLAGLAFAK----------------KGRSLHVVGTNGMASEM 100 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~-------~v~~v~~~~----------------~~~~l~s~~~dg~i~~w 100 (340)
.|++++.++.|.-.|..+|+.++++...... ....+++.. .+..++.++.|+.+.-.
T Consensus 196 ~lYv~t~~~~V~ALDa~TGk~lW~~d~~~~~~~~~~~~~cRGvay~~~p~~~~~~~~~~~p~~~~~rV~~~T~Dg~LiAL 275 (764)
T TIGR03074 196 TLYLCTPHNKVIALDAATGKEKWKFDPKLKTEAGRQHQTCRGVSYYDAPAAAAGPAAPAAPADCARRIILPTSDARLIAL 275 (764)
T ss_pred EEEEECCCCeEEEEECCCCcEEEEEcCCCCcccccccccccceEEecCCcccccccccccccccCCEEEEecCCCeEEEE
Confidence 6778888999999999999999998641110 012233321 34578889999999999
Q ss_pred eCCCCeEEEEee
Q 036605 101 KSEMGEVIREFK 112 (340)
Q Consensus 101 d~~~~~~~~~~~ 112 (340)
|..+|+.+..+.
T Consensus 276 DA~TGk~~W~fg 287 (764)
T TIGR03074 276 DADTGKLCEDFG 287 (764)
T ss_pred ECCCCCEEEEec
Confidence 999999887653
No 381
>TIGR03075 PQQ_enz_alc_DH PQQ-dependent dehydrogenase, methanol/ethanol family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Genes in this family often are found adjacent to the PQQ biosynthesis genes themselves. An unusual, strained disulfide bond between adjacent Cys residues contributes to PQQ-binding, as does a Trp residue that is part of a PQQ enzyme repeat (see pfam01011). Characterized members include the dehydrogenase subunit of a membrane-anchored, three subunit alcohol (ethanol) dehydrogenase of Gluconobacter suboxydans, a homodimeric ethanol dehydrogenase in Pseudomonas aeruginosa, and the large subunit of an alpha2/beta2 heterotetrameric methanol dehydrogenase in Methylobacterium extorquens.
Probab=96.79 E-value=0.32 Score=44.92 Aligned_cols=145 Identities=11% Similarity=0.183 Sum_probs=86.2
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCC-CCC--CeEE-EEEecCCCEEEEEeC------CCcEEEEeCCCCeEEEEeec
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGR-HPG--GLAG-LAFAKKGRSLHVVGT------NGMASEMKSEMGEVIREFKA 113 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~-h~~--~v~~-v~~~~~~~~l~s~~~------dg~i~~wd~~~~~~~~~~~~ 113 (340)
.++.++.++.|..+|.++|+.++..... +.. .+.+ .... ++ .++.+.. +|.|..+|..+|+.+..+..
T Consensus 122 ~v~v~t~dg~l~ALDa~TGk~~W~~~~~~~~~~~~~tssP~v~-~g-~Vivg~~~~~~~~~G~v~AlD~~TG~~lW~~~~ 199 (527)
T TIGR03075 122 KVFFGTLDARLVALDAKTGKVVWSKKNGDYKAGYTITAAPLVV-KG-KVITGISGGEFGVRGYVTAYDAKTGKLVWRRYT 199 (527)
T ss_pred EEEEEcCCCEEEEEECCCCCEEeecccccccccccccCCcEEE-CC-EEEEeecccccCCCcEEEEEECCCCceeEeccC
Confidence 4778889999999999999999887531 111 1211 1111 33 5555432 68999999999998876542
Q ss_pred CCC-------------------------------Ce-eEEEEccCCCEEEEec-------C-----------cEEEEECC
Q 036605 114 SEK-------------------------------PI-SSSAFLCEEKIFALAS-------S-----------EVRILSLE 143 (340)
Q Consensus 114 ~~~-------------------------------~i-~~l~~~~~~~~l~~~~-------~-----------~i~i~d~~ 143 (340)
-.. .+ ..+++.|...+++.+. + .|.-.|++
T Consensus 200 ~p~~~~~~~~~~~~~~~~~~~~tw~~~~~~~gg~~~W~~~s~D~~~~lvy~~tGnp~p~~~~~r~gdnl~~~s~vAld~~ 279 (527)
T TIGR03075 200 VPGDMGYLDKADKPVGGEPGAKTWPGDAWKTGGGATWGTGSYDPETNLIYFGTGNPSPWNSHLRPGDNLYTSSIVARDPD 279 (527)
T ss_pred cCCCcccccccccccccccccCCCCCCccccCCCCccCceeEcCCCCeEEEeCCCCCCCCCCCCCCCCccceeEEEEccc
Confidence 111 01 1235556555554421 1 27778899
Q ss_pred CCceeEEeecCCCCeE---------EEEECCCCC--EEEEEEcCCCeEEEEEccCCCCCc
Q 036605 144 NGEEVLKFSDDVGPLQ---------YVSASDGAK--IIITAGYGEKHLQVWRCDISSKTV 192 (340)
Q Consensus 144 ~~~~~~~~~~~~~~v~---------~~~~s~~~~--~l~s~~~~d~~i~iwd~~~~~~~~ 192 (340)
+|+..-.|+.....+. -+.+..+|+ -++..+..+|.+.+.|- .+++.
T Consensus 280 TG~~~W~~Q~~~~D~wD~d~~~~p~l~d~~~~G~~~~~v~~~~K~G~~~vlDr--~tG~~ 337 (527)
T TIGR03075 280 TGKIKWHYQTTPHDEWDYDGVNEMILFDLKKDGKPRKLLAHADRNGFFYVLDR--TNGKL 337 (527)
T ss_pred cCCEEEeeeCCCCCCccccCCCCcEEEEeccCCcEEEEEEEeCCCceEEEEEC--CCCce
Confidence 9988766644322221 122234565 34444555999999986 45544
No 382
>PF14583 Pectate_lyase22: Oligogalacturonate lyase; PDB: 3C5M_C 3PE7_A.
Probab=96.77 E-value=0.31 Score=42.23 Aligned_cols=165 Identities=12% Similarity=0.042 Sum_probs=82.3
Q ss_pred cCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEc---CC---CcEEEEEccCCeeEEEecCCCCC--
Q 036605 3 STNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGT---SN---GDILAVDVLTGEMKWKSTGRHPG-- 74 (340)
Q Consensus 3 d~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~---~d---g~i~i~d~~~~~~~~~~~~~h~~-- 74 (340)
|+.+|+....+. -..-+.-+.|||... .+|+.|- .+ ..|.+.+.. |...+.+.. |..
T Consensus 174 dl~tG~~~~v~~-----~~~wlgH~~fsP~dp--------~li~fCHEGpw~~Vd~RiW~i~~d-g~~~~~v~~-~~~~e 238 (386)
T PF14583_consen 174 DLKTGERKVVFE-----DTDWLGHVQFSPTDP--------TLIMFCHEGPWDLVDQRIWTINTD-GSNVKKVHR-RMEGE 238 (386)
T ss_dssp ETTT--EEEEEE-----ESS-EEEEEEETTEE--------EEEEEEE-S-TTTSS-SEEEEETT-S---EESS----TTE
T ss_pred ECCCCceeEEEe-----cCccccCcccCCCCC--------CEEEEeccCCcceeceEEEEEEcC-CCcceeeec-CCCCc
Confidence 456666555444 224556788898873 0444432 22 244444533 334455544 322
Q ss_pred CeEEEEEecCCCEEEEEe-----CCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE-ecC-------------
Q 036605 75 GLAGLAFAKKGRSLHVVG-----TNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL-ASS------------- 135 (340)
Q Consensus 75 ~v~~v~~~~~~~~l~s~~-----~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~-~~~------------- 135 (340)
.+..=-|.|||..|..-+ .+..|.-+|+.+++....... . ....+-.++||++++. +++
T Consensus 239 ~~gHEfw~~DG~~i~y~~~~~~~~~~~i~~~d~~t~~~~~~~~~-p-~~~H~~ss~Dg~L~vGDG~d~p~~v~~~~~~~~ 316 (386)
T PF14583_consen 239 SVGHEFWVPDGSTIWYDSYTPGGQDFWIAGYDPDTGERRRLMEM-P-WCSHFMSSPDGKLFVGDGGDAPVDVADAGGYKI 316 (386)
T ss_dssp EEEEEEE-TTSS-EEEEEEETTT--EEEEEE-TTT--EEEEEEE---SEEEEEE-TTSSEEEEEE---------------
T ss_pred ccccccccCCCCEEEEEeecCCCCceEEEeeCCCCCCceEEEeC-C-ceeeeEEcCCCCEEEecCCCCCcccccccccee
Confidence 344556899998766533 244678889998876443322 1 3445667889998876 221
Q ss_pred ----cEEEEECCCCceeEEeecCC----------C-CeEEEEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 136 ----EVRILSLENGEEVLKFSDDV----------G-PLQYVSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 136 ----~i~i~d~~~~~~~~~~~~~~----------~-~v~~~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
-|++++++.+... .+..|. . .-..+.|+|||++++..+...|...||-+
T Consensus 317 ~~~p~i~~~~~~~~~~~-~l~~h~~sw~v~~~~~q~~hPhp~FSPDgk~VlF~Sd~~G~~~vY~v 380 (386)
T PF14583_consen 317 ENDPWIYLFDVEAGRFR-KLARHDTSWKVLDGDRQVTHPHPSFSPDGKWVLFRSDMEGPPAVYLV 380 (386)
T ss_dssp ----EEEEEETTTTEEE-EEEE-------BTTBSSTT----EE-TTSSEEEEEE-TTSS-EEEEE
T ss_pred cCCcEEEEeccccCcee-eeeeccCcceeecCCCccCCCCCccCCCCCEEEEECCCCCCccEEEE
Confidence 1567888766432 221121 1 12568999999999988887888888866
No 383
>PF12234 Rav1p_C: RAVE protein 1 C terminal; InterPro: IPR022033 This domain family is found in eukaryotes, and is typically between 621 and 644 amino acids in length. This family is the C-terminal region of the protein RAVE (regulator of the ATPase of vacuolar and endosomal membranes). Rav1p is involved in regulating the glucose dependent assembly and disassembly of vacuolar ATPase V1 and V0 subunits.
Probab=96.73 E-value=0.058 Score=49.94 Aligned_cols=99 Identities=14% Similarity=0.238 Sum_probs=70.7
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEe--cCCCEEEEEeCCCcEEEEeCC---------CCeEEEE--
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFA--KKGRSLHVVGTNGMASEMKSE---------MGEVIRE-- 110 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~--~~~~~l~s~~~dg~i~~wd~~---------~~~~~~~-- 110 (340)
..++-+....+.|||...+.....-.-...+.|.++.|. |+++.+++.|....|.++.-. +...+..
T Consensus 43 ~a~V~~~~~~LtIWD~~~~~lE~~~~f~~~~~I~dLDWtst~d~qsiLaVGf~~~v~l~~Q~R~dy~~~~p~w~~i~~i~ 122 (631)
T PF12234_consen 43 IAVVDSSRSELTIWDTRSGVLEYEESFSEDDPIRDLDWTSTPDGQSILAVGFPHHVLLYTQLRYDYTNKGPSWAPIRKID 122 (631)
T ss_pred EEEEECCCCEEEEEEcCCcEEEEeeeecCCCceeeceeeecCCCCEEEEEEcCcEEEEEEccchhhhcCCcccceeEEEE
Confidence 444455556899999988874433221257799999995 588999999999999988531 1122333
Q ss_pred eecCC-CCeeEEEEccCCCEEEEecCcEEEEEC
Q 036605 111 FKASE-KPISSSAFLCEEKIFALASSEVRILSL 142 (340)
Q Consensus 111 ~~~~~-~~i~~l~~~~~~~~l~~~~~~i~i~d~ 142 (340)
+..+. .+|.+..|.++|..++.+++.+.|+|-
T Consensus 123 i~~~T~h~Igds~Wl~~G~LvV~sGNqlfv~dk 155 (631)
T PF12234_consen 123 ISSHTPHPIGDSIWLKDGTLVVGSGNQLFVFDK 155 (631)
T ss_pred eecCCCCCccceeEecCCeEEEEeCCEEEEECC
Confidence 22233 578899999999999999999999974
No 384
>PF05096 Glu_cyclase_2: Glutamine cyclotransferase; InterPro: IPR007788 This family of enzymes 2.3.2.5 from EC catalyse the cyclization of free L-glutamine and N-terminal glutaminyl residues in proteins to pyroglutamate (5-oxoproline) and pyroglutamyl residues respectively []. This family includes plant and bacterial enzymes and seems unrelated to the mammalian enzymes.; PDB: 3NOK_B 2FAW_A 2IWA_A 3NOM_A 3NOL_A 3MBR_X.
Probab=96.68 E-value=0.27 Score=40.30 Aligned_cols=127 Identities=17% Similarity=0.157 Sum_probs=82.3
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecC--CC---Ce
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKAS--EK---PI 118 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~--~~---~i 118 (340)
+...--.++...+||..+-+.+.++. ..+.=..++ .++..|+.......+..+|..+.+....+... .. .+
T Consensus 102 l~qLTWk~~~~f~yd~~tl~~~~~~~--y~~EGWGLt--~dg~~Li~SDGS~~L~~~dP~~f~~~~~i~V~~~g~pv~~L 177 (264)
T PF05096_consen 102 LYQLTWKEGTGFVYDPNTLKKIGTFP--YPGEGWGLT--SDGKRLIMSDGSSRLYFLDPETFKEVRTIQVTDNGRPVSNL 177 (264)
T ss_dssp EEEEESSSSEEEEEETTTTEEEEEEE---SSS--EEE--ECSSCEEEE-SSSEEEEE-TTT-SEEEEEE-EETTEE---E
T ss_pred EEEEEecCCeEEEEccccceEEEEEe--cCCcceEEE--cCCCEEEEECCccceEEECCcccceEEEEEEEECCEECCCc
Confidence 66667788999999999998888886 345567777 35777777777789999999988776665422 22 34
Q ss_pred eEEEEccCCCEEEE--ecCcEEEEECCCCceeEEeec------------C---CCCeEEEEECCCCCEEEEEEc
Q 036605 119 SSSAFLCEEKIFAL--ASSEVRILSLENGEEVLKFSD------------D---VGPLQYVSASDGAKIIITAGY 175 (340)
Q Consensus 119 ~~l~~~~~~~~l~~--~~~~i~i~d~~~~~~~~~~~~------------~---~~~v~~~~~s~~~~~l~s~~~ 175 (340)
..+.+- +|.+.|= ....|...|..+|+....+.. + ..-.+.+++.|....|+.+|.
T Consensus 178 NELE~i-~G~IyANVW~td~I~~Idp~tG~V~~~iDls~L~~~~~~~~~~~~~~dVLNGIAyd~~~~~l~vTGK 250 (264)
T PF05096_consen 178 NELEYI-NGKIYANVWQTDRIVRIDPETGKVVGWIDLSGLRPEVGRDKSRQPDDDVLNGIAYDPETDRLFVTGK 250 (264)
T ss_dssp EEEEEE-TTEEEEEETTSSEEEEEETTT-BEEEEEE-HHHHHHHTSTTST--TTS-EEEEEEETTTTEEEEEET
T ss_pred EeEEEE-cCEEEEEeCCCCeEEEEeCCCCeEEEEEEhhHhhhcccccccccccCCeeEeEeEeCCCCEEEEEeC
Confidence 556665 4544433 333488889999987754410 1 245789999888777777665
No 385
>KOG2444 consensus WD40 repeat protein [General function prediction only]
Probab=96.61 E-value=0.01 Score=46.68 Aligned_cols=100 Identities=11% Similarity=0.131 Sum_probs=62.2
Q ss_pred EEEEEcCCCcEEEEEccCC-eeEEEecCCCCCCe-EEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCC-CCeeE
Q 036605 44 LLALGTSNGDILAVDVLTG-EMKWKSTGRHPGGL-AGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASE-KPISS 120 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~-~~~~~~~~~h~~~v-~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~-~~i~~ 120 (340)
-+++|+.+|.|.+|+.... ...-.+.. -...| ..+.--.++.+..+++.||.|+.|++...+.+.....|. .++..
T Consensus 72 ~~~vG~~dg~v~~~n~n~~g~~~d~~~s-~~e~i~~~Ip~~~~~~~~c~~~~dg~ir~~n~~p~k~~g~~g~h~~~~~e~ 150 (238)
T KOG2444|consen 72 KLMVGTSDGAVYVFNWNLEGAHSDRVCS-GEESIDLGIPNGRDSSLGCVGAQDGRIRACNIKPNKVLGYVGQHNFESGEE 150 (238)
T ss_pred eEEeecccceEEEecCCccchHHHhhhc-ccccceeccccccccceeEEeccCCceeeeccccCceeeeeccccCCCcce
Confidence 6899999999999986621 11111111 11223 223333355688889999999999999988877766666 45555
Q ss_pred EEEccCCCEEEEe----cCcEEEEECCC
Q 036605 121 SAFLCEEKIFALA----SSEVRILSLEN 144 (340)
Q Consensus 121 l~~~~~~~~l~~~----~~~i~i~d~~~ 144 (340)
+.++..+++++.+ +..++.|++..
T Consensus 151 ~ivv~sd~~i~~a~~S~d~~~k~W~ve~ 178 (238)
T KOG2444|consen 151 LIVVGSDEFLKIADTSHDRVLKKWNVEK 178 (238)
T ss_pred eEEecCCceEEeeccccchhhhhcchhh
Confidence 5555555555443 22266666643
No 386
>PHA03098 kelch-like protein; Provisional
Probab=96.56 E-value=0.27 Score=45.68 Aligned_cols=99 Identities=14% Similarity=0.139 Sum_probs=49.2
Q ss_pred EEEEEcCCC------cEEEEEccCCeeEEEecCCCCCCe-EEEEEecCCCEEEEEeCC-----CcEEEEeCCCCeEEEE-
Q 036605 44 LLALGTSNG------DILAVDVLTGEMKWKSTGRHPGGL-AGLAFAKKGRSLHVVGTN-----GMASEMKSEMGEVIRE- 110 (340)
Q Consensus 44 ~l~~g~~dg------~i~i~d~~~~~~~~~~~~~h~~~v-~~v~~~~~~~~l~s~~~d-----g~i~~wd~~~~~~~~~- 110 (340)
+++.|+.++ .+..||..+.+.. .+........ .+++ .-++..++.||.+ ..+..||+.+.+-...
T Consensus 297 lyv~GG~~~~~~~~~~v~~yd~~~~~W~-~~~~~~~~R~~~~~~-~~~~~lyv~GG~~~~~~~~~v~~yd~~~~~W~~~~ 374 (534)
T PHA03098 297 IYFIGGMNKNNLSVNSVVSYDTKTKSWN-KVPELIYPRKNPGVT-VFNNRIYVIGGIYNSISLNTVESWKPGESKWREEP 374 (534)
T ss_pred EEEECCCcCCCCeeccEEEEeCCCCeee-ECCCCCcccccceEE-EECCEEEEEeCCCCCEecceEEEEcCCCCceeeCC
Confidence 666666542 5778998877643 2222011111 1222 2256666667755 3477788776542211
Q ss_pred -eecCCCCeeEEEEccCCCEEEEec--------CcEEEEECCCCc
Q 036605 111 -FKASEKPISSSAFLCEEKIFALAS--------SEVRILSLENGE 146 (340)
Q Consensus 111 -~~~~~~~i~~l~~~~~~~~l~~~~--------~~i~i~d~~~~~ 146 (340)
+...... .+++ .-++++.+.|+ .++..||..+.+
T Consensus 375 ~lp~~r~~-~~~~-~~~~~iYv~GG~~~~~~~~~~v~~yd~~t~~ 417 (534)
T PHA03098 375 PLIFPRYN-PCVV-NVNNLIYVIGGISKNDELLKTVECFSLNTNK 417 (534)
T ss_pred CcCcCCcc-ceEE-EECCEEEEECCcCCCCcccceEEEEeCCCCe
Confidence 1111111 1222 23455555554 238889987754
No 387
>PF00780 CNH: CNH domain; InterPro: IPR001180 Based on sequence similarities a domain of homology has been identified in the following proteins []: Citron and Citron kinase. These two proteins interact with the GTP-bound forms of the small GTPases Rho and Rac but not with Cdc42. Myotonic dystrophy kinase-related Cdc42-binding kinase (MRCKalpha). This serine/threonine kinase interacts with the GTP-bound form of the small GTPase Cdc42 and to a lesser extent with that of Rac. NCK Interacting Kinase (NIK), a serine/threonine protein kinase. ROM-1 and ROM-2, from yeast. These proteins are GDP/GTP exchange proteins (GEPs) for the small GTP binding protein Rho1. This domain, called the citron homology domain, is often found after cysteine rich and pleckstrin homology (PH) domains at the C-terminal end of the proteins []. It acts as a regulatory domain and could be involved in macromolecular interactions [, ].; GO: 0005083 small GTPase regulator activity
Probab=96.50 E-value=0.41 Score=40.09 Aligned_cols=195 Identities=16% Similarity=0.146 Sum_probs=107.1
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEe-------------cCCCCCCeEEEE--EecCCCE
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKS-------------TGRHPGGLAGLA--FAKKGRS 87 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~-------------~~~h~~~v~~v~--~~~~~~~ 87 (340)
.|+.+...|+-. .|++- .|+.++++++..-.....- .-.....+...+ -...+..
T Consensus 37 ~I~ql~vl~~~~---------~llvL-sd~~l~~~~L~~l~~~~~~~~~~~~~~~~~~~~~~~~~~v~~f~~~~~~~~~~ 106 (275)
T PF00780_consen 37 SITQLSVLPELN---------LLLVL-SDGQLYVYDLDSLEPVSTSAPLAFPKSRSLPTKLPETKGVSFFAVNGGHEGSR 106 (275)
T ss_pred eEEEEEEecccC---------EEEEE-cCCccEEEEchhhccccccccccccccccccccccccCCeeEEeeccccccce
Confidence 488888888776 34433 4599999998764432210 000222344444 1123334
Q ss_pred EEEEeCCCcEEEEeCCCC-----eEEEEeecCCCCeeEEEEccCCCEEEEe-cCcEEEEECCCCceeEEeecC-------
Q 036605 88 LHVVGTNGMASEMKSEMG-----EVIREFKASEKPISSSAFLCEEKIFALA-SSEVRILSLENGEEVLKFSDD------- 154 (340)
Q Consensus 88 l~s~~~dg~i~~wd~~~~-----~~~~~~~~~~~~i~~l~~~~~~~~l~~~-~~~i~i~d~~~~~~~~~~~~~------- 154 (340)
.+.+.....|.+|..... +...++.. ...+.+++|. +..++.+ .....+.|+.++....-+...
T Consensus 107 ~L~va~kk~i~i~~~~~~~~~f~~~~ke~~l-p~~~~~i~~~--~~~i~v~~~~~f~~idl~~~~~~~l~~~~~~~~~~~ 183 (275)
T PF00780_consen 107 RLCVAVKKKILIYEWNDPRNSFSKLLKEISL-PDPPSSIAFL--GNKICVGTSKGFYLIDLNTGSPSELLDPSDSSSSFK 183 (275)
T ss_pred EEEEEECCEEEEEEEECCcccccceeEEEEc-CCCcEEEEEe--CCEEEEEeCCceEEEecCCCCceEEeCccCCcchhh
Confidence 444455558888776553 34455554 3667888888 4455554 566999999977543322111
Q ss_pred -----CCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCc
Q 036605 155 -----VGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGV 229 (340)
Q Consensus 155 -----~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~ 229 (340)
..++..+..+ ++.+|++ . +..-.+.+. .++..+...+.....+..+.+ . ..+|++.+.++
T Consensus 184 ~~~~~~~~~~~~~~~-~~e~Ll~--~-~~~g~fv~~---~G~~~r~~~i~W~~~p~~~~~--~-----~pyli~~~~~~- 248 (275)
T PF00780_consen 184 SRNSSSKPLGIFQLS-DNEFLLC--Y-DNIGVFVNK---NGEPSRKSTIQWSSAPQSVAY--S-----SPYLIAFSSNS- 248 (275)
T ss_pred hcccCCCceEEEEeC-CceEEEE--e-cceEEEEcC---CCCcCcccEEEcCCchhEEEE--E-----CCEEEEECCCE-
Confidence 1233333443 4556665 3 344444554 344444334444444444433 1 24677766655
Q ss_pred EEEEECCCCCccCCCC
Q 036605 230 AYSWDLKTVSQDEKTN 245 (340)
Q Consensus 230 i~vwd~~~~~~~~~~~ 245 (340)
|.||++.+++.+..+.
T Consensus 249 iEV~~~~~~~lvQ~i~ 264 (275)
T PF00780_consen 249 IEVRSLETGELVQTIP 264 (275)
T ss_pred EEEEECcCCcEEEEEE
Confidence 9999999987766333
No 388
>KOG1897 consensus Damage-specific DNA binding complex, subunit DDB1 [Replication, recombination and repair]
Probab=96.46 E-value=0.3 Score=46.85 Aligned_cols=177 Identities=11% Similarity=0.027 Sum_probs=108.4
Q ss_pred cEEEEEccCCeeEEEecCCCCC---CeEEEEEecC-CCEEEEEeC----------CCcEEEEeCCCCeEEEEeecC--CC
Q 036605 53 DILAVDVLTGEMKWKSTGRHPG---GLAGLAFAKK-GRSLHVVGT----------NGMASEMKSEMGEVIREFKAS--EK 116 (340)
Q Consensus 53 ~i~i~d~~~~~~~~~~~~~h~~---~v~~v~~~~~-~~~l~s~~~----------dg~i~~wd~~~~~~~~~~~~~--~~ 116 (340)
.++++|-.+-+.++..+-.... .|.++.|..| +.+++.|.. .|.|.++....++.+.....+ ++
T Consensus 751 ~l~vlD~nTf~vl~~hef~~~E~~~Si~s~~~~~d~~t~~vVGT~~v~Pde~ep~~GRIivfe~~e~~~L~~v~e~~v~G 830 (1096)
T KOG1897|consen 751 FLRVLDQNTFEVLSSHEFERNETALSIISCKFTDDPNTYYVVGTGLVYPDENEPVNGRIIVFEFEELNSLELVAETVVKG 830 (1096)
T ss_pred EEEEecCCceeEEeeccccccceeeeeeeeeecCCCceEEEEEEEeeccCCCCcccceEEEEEEecCCceeeeeeeeecc
Confidence 3567776666655443321222 3455568777 556666532 367777777664333333222 23
Q ss_pred CeeEEEEccCCCEEEEecCcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCc
Q 036605 117 PISSSAFLCEEKIFALASSEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGP 196 (340)
Q Consensus 117 ~i~~l~~~~~~~~l~~~~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~ 196 (340)
.+.++.. -+|+++|.-+..|++|++.+.+.++.-..+..++..+...-.|..++.+.. -+.+.+...+...+......
T Consensus 831 av~aL~~-fngkllA~In~~vrLye~t~~~eLr~e~~~~~~~~aL~l~v~gdeI~VgDl-m~Sitll~y~~~eg~f~evA 908 (1096)
T KOG1897|consen 831 AVYALVE-FNGKLLAGINQSVRLYEWTTERELRIECNISNPIIALDLQVKGDEIAVGDL-MRSITLLQYKGDEGNFEEVA 908 (1096)
T ss_pred ceeehhh-hCCeEEEecCcEEEEEEccccceehhhhcccCCeEEEEEEecCcEEEEeec-cceEEEEEEeccCCceEEee
Confidence 3444432 258888888888999999999888777788889999999888999999776 77777776643332221111
Q ss_pred eeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 197 ALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 197 ~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
. --++.|...+ . .-++..++.+..+|.+++....+
T Consensus 909 r--D~~p~Wmtav--e--il~~d~ylgae~~gNlf~v~~d~ 943 (1096)
T KOG1897|consen 909 R--DYNPNWMTAV--E--ILDDDTYLGAENSGNLFTVRKDS 943 (1096)
T ss_pred h--hhCccceeeE--E--EecCceEEeecccccEEEEEecC
Confidence 1 1233444433 2 23456677777888888876554
No 389
>TIGR02604 Piru_Ver_Nterm putative membrane-bound dehydrogenase domain. All proteins that score above the trusted cutoff score of 45 to this model are large proteins of either Pirellula sp. 1 or Verrucomicrobium spinosum. These proteins all contain, in addition to this domain, several hundred residues of highly variable sequence, and then a well-conserved C-terminal domain (TIGR02603) that features a putative cytochrome c-type heme binding motif CXXCH. The membrane-bound L-sorbosone dehydrogenase from Acetobacter liquefaciens (Gluconacetobacter liquefaciens) is homologous to this domain but lacks additional sequence regions shared by members of this family and belongs to a different clade of the larger family of homologs. It and its closely related homologs are excluded from the this model by scoring between the trusted (45) and noise (18) cutoffs.
Probab=96.39 E-value=0.35 Score=42.54 Aligned_cols=138 Identities=14% Similarity=0.104 Sum_probs=77.1
Q ss_pred CCeEEEEeeccccccccccCceEEEEEc-----------CCC-cEEEEEccC--Ce--eEEEecCCCCCCeEEEEEecCC
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGT-----------SNG-DILAVDVLT--GE--MKWKSTGRHPGGLAGLAFAKKG 85 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~-----------~dg-~i~i~d~~~--~~--~~~~~~~~h~~~v~~v~~~~~~ 85 (340)
.....|+|.++|+ ++++-. ..+ .|.+++-.+ |+ ....+.. .......+++.+++
T Consensus 14 ~~P~~ia~d~~G~---------l~V~e~~~y~~~~~~~~~~~~rI~~l~d~dgdG~~d~~~vfa~-~l~~p~Gi~~~~~G 83 (367)
T TIGR02604 14 RNPIAVCFDERGR---------LWVAEGITYSRPAGRQGPLGDRILILEDADGDGKYDKSNVFAE-ELSMVTGLAVAVGG 83 (367)
T ss_pred CCCceeeECCCCC---------EEEEeCCcCCCCCCCCCCCCCEEEEEEcCCCCCCcceeEEeec-CCCCccceeEecCC
Confidence 4567899999999 555532 223 787776543 32 2233333 33356889999888
Q ss_pred CEEEEEeCCCcEEEE-eCCC-----Ce--EEE-EeecC----CCCeeEEEEccCCCEEEEec------------------
Q 036605 86 RSLHVVGTNGMASEM-KSEM-----GE--VIR-EFKAS----EKPISSSAFLCEEKIFALAS------------------ 134 (340)
Q Consensus 86 ~~l~s~~~dg~i~~w-d~~~-----~~--~~~-~~~~~----~~~i~~l~~~~~~~~l~~~~------------------ 134 (340)
|+.++.. .|..| |... ++ .+. .+... ......+++.|||.+.++.+
T Consensus 84 --lyV~~~~-~i~~~~d~~gdg~ad~~~~~l~~~~~~~~~~~~~~~~~l~~gpDG~LYv~~G~~~~~~~~~~~~~~~~~~ 160 (367)
T TIGR02604 84 --VYVATPP-DILFLRDKDGDDKADGEREVLLSGFGGQINNHHHSLNSLAWGPDGWLYFNHGNTLASKVTRPGTSDESRQ 160 (367)
T ss_pred --EEEeCCC-eEEEEeCCCCCCCCCCccEEEEEccCCCCCcccccccCceECCCCCEEEecccCCCceeccCCCccCccc
Confidence 5555544 45444 4421 12 111 13221 23467899999998776533
Q ss_pred ---CcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEE
Q 036605 135 ---SEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITA 173 (340)
Q Consensus 135 ---~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~ 173 (340)
+.|.-++..+++ +..+.........++|+++|..+++-
T Consensus 161 ~~~g~i~r~~pdg~~-~e~~a~G~rnp~Gl~~d~~G~l~~td 201 (367)
T TIGR02604 161 GLGGGLFRYNPDGGK-LRVVAHGFQNPYGHSVDSWGDVFFCD 201 (367)
T ss_pred ccCceEEEEecCCCe-EEEEecCcCCCccceECCCCCEEEEc
Confidence 114444544443 22332222334689999999887663
No 390
>KOG2079 consensus Vacuolar assembly/sorting protein VPS8 [Intracellular trafficking, secretion, and vesicular transport]
Probab=96.38 E-value=0.014 Score=55.83 Aligned_cols=69 Identities=19% Similarity=0.202 Sum_probs=54.5
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEE---EEEecCCCEEEEEeCCC
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAG---LAFAKKGRSLHVVGTNG 95 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~---v~~~~~~~~l~s~~~dg 95 (340)
+..++|+|++|+.+|+ +++.|-.+|.|.+||+..++..+.+.. |..+.++ +.+..++..++++...|
T Consensus 128 ~v~~~Vtsvafn~dg~---------~l~~G~~~G~V~v~D~~~~k~l~~i~e-~~ap~t~vi~v~~t~~nS~llt~D~~G 197 (1206)
T KOG2079|consen 128 RVQGPVTSVAFNQDGS---------LLLAGLGDGHVTVWDMHRAKILKVITE-HGAPVTGVIFVGRTSQNSKLLTSDTGG 197 (1206)
T ss_pred ccCCcceeeEecCCCc---------eeccccCCCcEEEEEccCCcceeeeee-cCCccceEEEEEEeCCCcEEEEccCCC
Confidence 3458999999999999 999999999999999999988877766 5544444 34444666788887778
Q ss_pred cE
Q 036605 96 MA 97 (340)
Q Consensus 96 ~i 97 (340)
.+
T Consensus 198 sf 199 (1206)
T KOG2079|consen 198 SF 199 (1206)
T ss_pred ce
Confidence 63
No 391
>KOG4499 consensus Ca2+-binding protein Regucalcin/SMP30 [Inorganic ion transport and metabolism; Signal transduction mechanisms]
Probab=96.37 E-value=0.38 Score=38.37 Aligned_cols=91 Identities=11% Similarity=0.158 Sum_probs=62.0
Q ss_pred CeEEEEEecCCCEEEEE-eCCCcEEEEe--CCCCeE-----EEEeec----CCCCeeEEEEccCCCEEEE--ecCcEEEE
Q 036605 75 GLAGLAFAKKGRSLHVV-GTNGMASEMK--SEMGEV-----IREFKA----SEKPISSSAFLCEEKIFAL--ASSEVRIL 140 (340)
Q Consensus 75 ~v~~v~~~~~~~~l~s~-~~dg~i~~wd--~~~~~~-----~~~~~~----~~~~i~~l~~~~~~~~l~~--~~~~i~i~ 140 (340)
.-+.++|+.+.+.++.. +.+-.|.-|| ..+|.. +..++. ..-..-.+++..+|.+.++ .+++|...
T Consensus 159 IsNgl~Wd~d~K~fY~iDsln~~V~a~dyd~~tG~~snr~~i~dlrk~~~~e~~~PDGm~ID~eG~L~Va~~ng~~V~~~ 238 (310)
T KOG4499|consen 159 ISNGLAWDSDAKKFYYIDSLNYEVDAYDYDCPTGDLSNRKVIFDLRKSQPFESLEPDGMTIDTEGNLYVATFNGGTVQKV 238 (310)
T ss_pred CCccccccccCcEEEEEccCceEEeeeecCCCcccccCcceeEEeccCCCcCCCCCCcceEccCCcEEEEEecCcEEEEE
Confidence 34678999888776665 4566776677 666643 222221 1112234566667776654 55669999
Q ss_pred ECCCCceeEEeecCCCCeEEEEECC
Q 036605 141 SLENGEEVLKFSDDVGPLQYVSASD 165 (340)
Q Consensus 141 d~~~~~~~~~~~~~~~~v~~~~~s~ 165 (340)
|..+|+.+.++.-....+++++|-.
T Consensus 239 dp~tGK~L~eiklPt~qitsccFgG 263 (310)
T KOG4499|consen 239 DPTTGKILLEIKLPTPQITSCCFGG 263 (310)
T ss_pred CCCCCcEEEEEEcCCCceEEEEecC
Confidence 9999999999988888999999953
No 392
>PF12894 Apc4_WD40: Anaphase-promoting complex subunit 4 WD40 domain
Probab=96.36 E-value=0.014 Score=33.88 Aligned_cols=34 Identities=6% Similarity=0.058 Sum_probs=29.8
Q ss_pred CCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCe
Q 036605 72 HPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGE 106 (340)
Q Consensus 72 h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~ 106 (340)
....|.+++|+|....|+.+..+|.|.++.+ +++
T Consensus 10 l~~~v~~~~w~P~mdLiA~~t~~g~v~v~Rl-~~q 43 (47)
T PF12894_consen 10 LPSRVSCMSWCPTMDLIALGTEDGEVLVYRL-NWQ 43 (47)
T ss_pred CCCcEEEEEECCCCCEEEEEECCCeEEEEEC-CCc
Confidence 3457999999999999999999999999988 444
No 393
>PRK10115 protease 2; Provisional
Probab=96.33 E-value=1.1 Score=43.06 Aligned_cols=109 Identities=12% Similarity=0.024 Sum_probs=66.8
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCC-----CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCC--
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSN-----GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTN-- 94 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~d-----g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~d-- 94 (340)
-.+..+.|||+++ +|+.+... ..|++.|+.+|..+..... . .-..++|.+|++.|+....+
T Consensus 127 ~~l~~~~~Spdg~---------~la~~~d~~G~E~~~l~v~d~~tg~~l~~~i~-~--~~~~~~w~~D~~~~~y~~~~~~ 194 (686)
T PRK10115 127 YTLGGMAITPDNT---------IMALAEDFLSRRQYGIRFRNLETGNWYPELLD-N--VEPSFVWANDSWTFYYVRKHPV 194 (686)
T ss_pred EEEeEEEECCCCC---------EEEEEecCCCcEEEEEEEEECCCCCCCCcccc-C--cceEEEEeeCCCEEEEEEecCC
Confidence 4567788999998 77765432 4688999988863322211 1 12569999999876665432
Q ss_pred ----CcEEEEeCCCC--eEEEEeecCCCCee-EEEEccCCCEEEEe-----cCcEEEEEC
Q 036605 95 ----GMASEMKSEMG--EVIREFKASEKPIS-SSAFLCEEKIFALA-----SSEVRILSL 142 (340)
Q Consensus 95 ----g~i~~wd~~~~--~~~~~~~~~~~~i~-~l~~~~~~~~l~~~-----~~~i~i~d~ 142 (340)
..|..+++.++ +....+........ .+..+.++++++.. ++.+.+++.
T Consensus 195 ~~~~~~v~~h~lgt~~~~d~lv~~e~~~~~~~~~~~s~d~~~l~i~~~~~~~~~~~l~~~ 254 (686)
T PRK10115 195 TLLPYQVWRHTIGTPASQDELVYEEKDDTFYVSLHKTTSKHYVVIHLASATTSEVLLLDA 254 (686)
T ss_pred CCCCCEEEEEECCCChhHCeEEEeeCCCCEEEEEEEcCCCCEEEEEEECCccccEEEEEC
Confidence 36788888887 33334443333333 33445578776551 223888884
No 394
>PRK13684 Ycf48-like protein; Provisional
Probab=96.27 E-value=0.67 Score=40.14 Aligned_cols=151 Identities=14% Similarity=0.040 Sum_probs=86.9
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEE
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEM 100 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~w 100 (340)
...+.++.+.|++. ++++| ..|.+..-.-..++.-......-...++++.+.++++.++. +..|.+.+=
T Consensus 172 ~g~~~~i~~~~~g~---------~v~~g-~~G~i~~s~~~gg~tW~~~~~~~~~~l~~i~~~~~g~~~~v-g~~G~~~~~ 240 (334)
T PRK13684 172 AGVVRNLRRSPDGK---------YVAVS-SRGNFYSTWEPGQTAWTPHQRNSSRRLQSMGFQPDGNLWML-ARGGQIRFN 240 (334)
T ss_pred cceEEEEEECCCCe---------EEEEe-CCceEEEEcCCCCCeEEEeeCCCcccceeeeEcCCCCEEEE-ecCCEEEEc
Confidence 35678888888877 55555 45655432112222122222224467899999998876665 556766543
Q ss_pred eCCCCeEEEEeec----CCCCeeEEEEccCCCEEEEecCcEEEEECCCCceeEEee---cCCCCeEEEEECCCCCEEEEE
Q 036605 101 KSEMGEVIREFKA----SEKPISSSAFLCEEKIFALASSEVRILSLENGEEVLKFS---DDVGPLQYVSASDGAKIIITA 173 (340)
Q Consensus 101 d~~~~~~~~~~~~----~~~~i~~l~~~~~~~~l~~~~~~i~i~d~~~~~~~~~~~---~~~~~v~~~~~s~~~~~l~s~ 173 (340)
....|..-..... ....+..+.+.|++..++++..-..+.....++.-.... .-......+.|..+++.+++
T Consensus 241 s~d~G~sW~~~~~~~~~~~~~l~~v~~~~~~~~~~~G~~G~v~~S~d~G~tW~~~~~~~~~~~~~~~~~~~~~~~~~~~- 319 (334)
T PRK13684 241 DPDDLESWSKPIIPEITNGYGYLDLAYRTPGEIWAGGGNGTLLVSKDGGKTWEKDPVGEEVPSNFYKIVFLDPEKGFVL- 319 (334)
T ss_pred cCCCCCccccccCCccccccceeeEEEcCCCCEEEEcCCCeEEEeCCCCCCCeECCcCCCCCcceEEEEEeCCCceEEE-
Confidence 3444443222211 123477889999888777655444445555554333332 22245778888777777666
Q ss_pred EcCCCeEEEEE
Q 036605 174 GYGEKHLQVWR 184 (340)
Q Consensus 174 ~~~d~~i~iwd 184 (340)
+. .|.|--|+
T Consensus 320 G~-~G~il~~~ 329 (334)
T PRK13684 320 GQ-RGVLLRYV 329 (334)
T ss_pred CC-CceEEEec
Confidence 55 68887776
No 395
>PF05694 SBP56: 56kDa selenium binding protein (SBP56); InterPro: IPR008826 This family consists of several eukaryotic selenium binding proteins as well as three sequences from archaea. The exact function of this protein is unknown although it is thought that SBP56 participates in late stages of intra-Golgi protein transport []. The Lotus japonicus homologue of SBP56, LjSBP is thought to have more than one physiological role and can be implicated in controlling the oxidation/reduction status of target proteins in vesicular Golgi transport [].; GO: 0008430 selenium binding; PDB: 2ECE_A.
Probab=95.96 E-value=1.1 Score=39.62 Aligned_cols=135 Identities=10% Similarity=0.046 Sum_probs=71.0
Q ss_pred CcEEEEEccCCeeEEEecC--CCCCCeEEEEEecCCCEEEEEeC--------------------CCcEEEEeCCCCeEEE
Q 036605 52 GDILAVDVLTGEMKWKSTG--RHPGGLAGLAFAKKGRSLHVVGT--------------------NGMASEMKSEMGEVIR 109 (340)
Q Consensus 52 g~i~i~d~~~~~~~~~~~~--~h~~~v~~v~~~~~~~~l~s~~~--------------------dg~i~~wd~~~~~~~~ 109 (340)
|-+.++|-++.+....+.. .....-+.+-|.|..+.++|... ...+.+||+.+.+.++
T Consensus 157 Ggf~llD~~tf~v~g~We~~~~~~~~gYDfw~qpr~nvMiSSeWg~P~~~~~Gf~~~d~~~~~yG~~l~vWD~~~r~~~Q 236 (461)
T PF05694_consen 157 GGFVLLDGETFEVKGRWEKDRGPQPFGYDFWYQPRHNVMISSEWGAPSMFEKGFNPEDLEAGKYGHSLHVWDWSTRKLLQ 236 (461)
T ss_dssp -EEEEE-TTT--EEEE--SB-TT------EEEETTTTEEEE-B---HHHHTT---TTTHHHH-S--EEEEEETTTTEEEE
T ss_pred CcEEEEcCccccccceeccCCCCCCCCCCeEEcCCCCEEEEeccCChhhcccCCChhHhhcccccCeEEEEECCCCcEee
Confidence 5688889888777777654 12334578888998888888432 2479999999999999
Q ss_pred EeecCCCC--eeEEEEccC--CCEEEE---ecCcEEEE-ECCCCc----eeEEeec-----------------CCCCeEE
Q 036605 110 EFKASEKP--ISSSAFLCE--EKIFAL---ASSEVRIL-SLENGE----EVLKFSD-----------------DVGPLQY 160 (340)
Q Consensus 110 ~~~~~~~~--i~~l~~~~~--~~~l~~---~~~~i~i~-d~~~~~----~~~~~~~-----------------~~~~v~~ 160 (340)
.+...... ...|.|..+ ..+-++ -+.+|..| ....++ .+..+.. -..-|+.
T Consensus 237 ~idLg~~g~~pLEvRflH~P~~~~gFvg~aLss~i~~~~k~~~g~W~a~kVi~ip~~~v~~~~lp~ml~~~~~~P~LitD 316 (461)
T PF05694_consen 237 TIDLGEEGQMPLEVRFLHDPDANYGFVGCALSSSIWRFYKDDDGEWAAEKVIDIPAKKVEGWILPEMLKPFGAVPPLITD 316 (461)
T ss_dssp EEES-TTEEEEEEEEE-SSTT--EEEEEEE--EEEEEEEE-ETTEEEEEEEEEE--EE--SS---GGGGGG-EE------
T ss_pred EEecCCCCCceEEEEecCCCCccceEEEEeccceEEEEEEcCCCCeeeeEEEECCCcccCcccccccccccccCCCceEe
Confidence 98765433 345556543 333222 22334443 323332 1122211 1345789
Q ss_pred EEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 161 VSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 161 ~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
+.+|.|.++|+.+...+|.|+.||+.
T Consensus 317 I~iSlDDrfLYvs~W~~GdvrqYDIS 342 (461)
T PF05694_consen 317 ILISLDDRFLYVSNWLHGDVRQYDIS 342 (461)
T ss_dssp EEE-TTS-EEEEEETTTTEEEEEE-S
T ss_pred EEEccCCCEEEEEcccCCcEEEEecC
Confidence 99999999999999999999999993
No 396
>KOG4499 consensus Ca2+-binding protein Regucalcin/SMP30 [Inorganic ion transport and metabolism; Signal transduction mechanisms]
Probab=95.92 E-value=0.67 Score=37.05 Aligned_cols=189 Identities=14% Similarity=0.139 Sum_probs=103.2
Q ss_pred EEEEEcCCCcEEEEEccCCeeEE-EecCCCCCCeEEEEEecCC---CEEEEEeCCCcEEEEeCC--CCeEEEEee-----
Q 036605 44 LLALGTSNGDILAVDVLTGEMKW-KSTGRHPGGLAGLAFAKKG---RSLHVVGTNGMASEMKSE--MGEVIREFK----- 112 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~-~~~~~h~~~v~~v~~~~~~---~~l~s~~~dg~i~~wd~~--~~~~~~~~~----- 112 (340)
++.+--..|.|+-||.+..+... ++.+ . ...++.+--.+ .+.+.++..-.|.-||.. ......++.
T Consensus 29 Ll~VDi~ag~v~r~D~~qn~v~ra~ie~-p--~~ag~ilpv~~~~q~~~v~~G~kf~i~nwd~~~~~a~v~~t~~ev~~d 105 (310)
T KOG4499|consen 29 LLYVDIEAGEVHRYDIEQNKVYRAKIEG-P--PSAGFILPVEGGPQEFAVGCGSKFVIVNWDGVSESAKVYRTLFEVQPD 105 (310)
T ss_pred EEEEEeccCceehhhhhhhheEEEEEec-C--cceeEEEEecCCCceEEEeecceEEEEEcccccceeeeeeeccccCch
Confidence 67777778888889988765433 2332 1 23333332222 244445555556667733 223333311
Q ss_pred cCCCCeeEEEEccCCCEEEEe-c----------CcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEE
Q 036605 113 ASEKPISSSAFLCEEKIFALA-S----------SEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQ 181 (340)
Q Consensus 113 ~~~~~i~~l~~~~~~~~l~~~-~----------~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~ 181 (340)
..+.....-.++|+|++++.. . +.++.|-+.. .+..+...-.--+.++|+.+.+.++...+.+-.|.
T Consensus 106 ~kknR~NDgkvdP~Gryy~GtMad~~~~le~~~g~Ly~~~~~h--~v~~i~~~v~IsNgl~Wd~d~K~fY~iDsln~~V~ 183 (310)
T KOG4499|consen 106 RKKNRLNDGKVDPDGRYYGGTMADFGDDLEPIGGELYSWLAGH--QVELIWNCVGISNGLAWDSDAKKFYYIDSLNYEVD 183 (310)
T ss_pred HHhcccccCccCCCCceeeeeeccccccccccccEEEEeccCC--CceeeehhccCCccccccccCcEEEEEccCceEEe
Confidence 113345566788999996541 1 1144443322 22223333344567899988888877666577888
Q ss_pred EEEccCCCCCccCC-ceeeecCC-------CeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 182 VWRCDISSKTVNKG-PALSMRHS-------PVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 182 iwd~~~~~~~~~~~-~~~~~~~~-------~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
-||.+.+++..... ..+.+... +--..+ ..+|...++.-..|+|..+|..+++.+.
T Consensus 184 a~dyd~~tG~~snr~~i~dlrk~~~~e~~~PDGm~I-----D~eG~L~Va~~ng~~V~~~dp~tGK~L~ 247 (310)
T KOG4499|consen 184 AYDYDCPTGDLSNRKVIFDLRKSQPFESLEPDGMTI-----DTEGNLYVATFNGGTVQKVDPTTGKILL 247 (310)
T ss_pred eeecCCCcccccCcceeEEeccCCCcCCCCCCcceE-----ccCCcEEEEEecCcEEEEECCCCCcEEE
Confidence 89976566644321 11111110 111111 3466677777778888888888887665
No 397
>PF15390 DUF4613: Domain of unknown function (DUF4613)
Probab=95.90 E-value=0.46 Score=43.14 Aligned_cols=146 Identities=13% Similarity=0.118 Sum_probs=84.9
Q ss_pred CCeEEEEeeccccccccccCceEEEEEc--CCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCC----CEEEEEeCCC
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGT--SNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKG----RSLHVVGTNG 95 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~--~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~----~~l~s~~~dg 95 (340)
-++..++|. ||+ ..+.+.- .+|.+.+=| .+.+..| ..|.+++|.|-+ ..|++.-...
T Consensus 20 HPvhGlaWT-DGk--------qVvLT~L~l~~gE~kfGd---s~viGqF-----EhV~GlsW~P~~~~~~paLLAVQHkk 82 (671)
T PF15390_consen 20 HPVHGLAWT-DGK--------QVVLTDLQLHNGEPKFGD---SKVIGQF-----EHVHGLSWAPPCTADTPALLAVQHKK 82 (671)
T ss_pred ccccceEec-CCC--------EEEEEeeeeeCCccccCC---ccEeecc-----ceeeeeeecCcccCCCCceEEEeccc
Confidence 367788887 454 0344332 334433322 1233333 358999999853 2456667788
Q ss_pred cEEEEeCCC-----CeEEEEeecC---CC--CeeEEEEccCCCEEEE-ecCcE-EEEECCCCc--eeEEeecCCCCeEEE
Q 036605 96 MASEMKSEM-----GEVIREFKAS---EK--PISSSAFLCEEKIFAL-ASSEV-RILSLENGE--EVLKFSDDVGPLQYV 161 (340)
Q Consensus 96 ~i~~wd~~~-----~~~~~~~~~~---~~--~i~~l~~~~~~~~l~~-~~~~i-~i~d~~~~~--~~~~~~~~~~~v~~~ 161 (340)
.|.+|.+.. ++.+..-..+ .- -...+.|+|....|++ ..+++ .+++.+... ....+ ...+.|.+.
T Consensus 83 hVtVWqL~~s~~e~~K~l~sQtcEi~e~~pvLpQGCVWHPk~~iL~VLT~~dvSV~~sV~~d~srVkaDi-~~~G~IhCA 161 (671)
T PF15390_consen 83 HVTVWQLCPSTTERNKLLMSQTCEIREPFPVLPQGCVWHPKKAILTVLTARDVSVLPSVHCDSSRVKADI-KTSGLIHCA 161 (671)
T ss_pred eEEEEEeccCccccccceeeeeeeccCCcccCCCcccccCCCceEEEEecCceeEeeeeeeCCceEEEec-cCCceEEEE
Confidence 999998752 2222221111 11 1245679999988866 55554 344554322 22333 346789999
Q ss_pred EECCCCCEEEEEEcCCCeEEEEEc
Q 036605 162 SASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 162 ~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
+|..||+.|+.+-...=.-+|||-
T Consensus 162 CWT~DG~RLVVAvGSsLHSyiWd~ 185 (671)
T PF15390_consen 162 CWTKDGQRLVVAVGSSLHSYIWDS 185 (671)
T ss_pred EecCcCCEEEEEeCCeEEEEEecC
Confidence 999999998886543344567773
No 398
>KOG1897 consensus Damage-specific DNA binding complex, subunit DDB1 [Replication, recombination and repair]
Probab=95.90 E-value=1.8 Score=41.87 Aligned_cols=196 Identities=14% Similarity=0.025 Sum_probs=114.5
Q ss_pred CeEEEEeecc-ccccccccCceEEEEEcC----------CCcEEEEEccCCeeEEEecC-CCCCCeEEEEEecCCCEEEE
Q 036605 23 SYSCLACGFV-GKKRRKERGTLLLALGTS----------NGDILAVDVLTGEMKWKSTG-RHPGGLAGLAFAKKGRSLHV 90 (340)
Q Consensus 23 ~v~~l~~sp~-~~~~~~~~~~~~l~~g~~----------dg~i~i~d~~~~~~~~~~~~-~h~~~v~~v~~~~~~~~l~s 90 (340)
.|.+..|..| +. ++++|+. .|.|.+|....++.+..+.. .-.+.+.++..- +|++|+
T Consensus 776 Si~s~~~~~d~~t---------~~vVGT~~v~Pde~ep~~GRIivfe~~e~~~L~~v~e~~v~Gav~aL~~f-ngkllA- 844 (1096)
T KOG1897|consen 776 SIISCKFTDDPNT---------YYVVGTGLVYPDENEPVNGRIIVFEFEELNSLELVAETVVKGAVYALVEF-NGKLLA- 844 (1096)
T ss_pred eeeeeeecCCCce---------EEEEEEEeeccCCCCcccceEEEEEEecCCceeeeeeeeeccceeehhhh-CCeEEE-
Confidence 3444557766 45 7888753 48889988877433333322 134566666543 466555
Q ss_pred EeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc----EEEEECCCCceeEEe-ecCCCCeEEEEECC
Q 036605 91 VGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE----VRILSLENGEEVLKF-SDDVGPLQYVSASD 165 (340)
Q Consensus 91 ~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~----i~i~d~~~~~~~~~~-~~~~~~v~~~~~s~ 165 (340)
+-...|++|++.+.+.++.-..+..++..+.+.-.|..++++|-- +..|+-..|.....- .-++.+.+++.+-.
T Consensus 845 -~In~~vrLye~t~~~eLr~e~~~~~~~~aL~l~v~gdeI~VgDlm~Sitll~y~~~eg~f~evArD~~p~Wmtaveil~ 923 (1096)
T KOG1897|consen 845 -GINQSVRLYEWTTERELRIECNISNPIIALDLQVKGDEIAVGDLMRSITLLQYKGDEGNFEEVARDYNPNWMTAVEILD 923 (1096)
T ss_pred -ecCcEEEEEEccccceehhhhcccCCeEEEEEEecCcEEEEeeccceEEEEEEeccCCceEEeehhhCccceeeEEEec
Confidence 445689999998887666655667788888888889999887754 444444444222111 34567888888887
Q ss_pred CCCEEEEEEcCCCeEEEEEccCCCCCccC-------------CceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEE
Q 036605 166 GAKIIITAGYGEKHLQVWRCDISSKTVNK-------------GPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYS 232 (340)
Q Consensus 166 ~~~~l~s~~~~d~~i~iwd~~~~~~~~~~-------------~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~v 232 (340)
+..|+.+ ..+|.+.+-..+....+... .....+.|...+....... .+-+..++.|+.+|.|-+
T Consensus 924 ~d~ylga--e~~gNlf~v~~d~~~~td~eR~~l~~~~~~hlGelvn~f~hg~lv~~~~~s~-~~~~~~vlfgTv~GsIG~ 1000 (1096)
T KOG1897|consen 924 DDTYLGA--ENSGNLFTVRKDSDATTDEERQILEEVGKFHLGELVNKFRHGSLVMQLGDSM-IPLEPKVLFGTVNGSIGI 1000 (1096)
T ss_pred CceEEee--cccccEEEEEecCCCCchhhhhcccceeeEEeccceeeeeecceEeeccccc-cCCCCcEEEEEccceEEE
Confidence 7766655 33677776665322211100 1111122333333311111 344555888999998865
Q ss_pred E
Q 036605 233 W 233 (340)
Q Consensus 233 w 233 (340)
.
T Consensus 1001 i 1001 (1096)
T KOG1897|consen 1001 I 1001 (1096)
T ss_pred E
Confidence 4
No 399
>PF06977 SdiA-regulated: SdiA-regulated; InterPro: IPR009722 This entry represents a conserved region approximately 100 residues long within a number of hypothetical bacterial proteins that may be regulated by SdiA, a member of the LuxR family of transcriptional regulators []. Some proteins contain the IPR001258 from INTERPRO repeat.; PDB: 3QQZ_A.
Probab=95.87 E-value=0.81 Score=37.58 Aligned_cols=163 Identities=13% Similarity=0.104 Sum_probs=83.0
Q ss_pred CCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCe------eEEEe----cCCCCCC
Q 036605 6 DGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGE------MKWKS----TGRHPGG 75 (340)
Q Consensus 6 ~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~------~~~~~----~~~h~~~ 75 (340)
+|+++..+.- ......-.+++..++. ++++--.++.+.++++.... ....+ ...+...
T Consensus 52 ~G~vlr~i~l---~g~~D~EgI~y~g~~~---------~vl~~Er~~~L~~~~~~~~~~~~~~~~~~~~~l~~~~~~N~G 119 (248)
T PF06977_consen 52 DGKVLRRIPL---DGFGDYEGITYLGNGR---------YVLSEERDQRLYIFTIDDDTTSLDRADVQKISLGFPNKGNKG 119 (248)
T ss_dssp T--EEEEEE----SS-SSEEEEEE-STTE---------EEEEETTTTEEEEEEE----TT--EEEEEEEE---S---SS-
T ss_pred CCCEEEEEeC---CCCCCceeEEEECCCE---------EEEEEcCCCcEEEEEEeccccccchhhceEEecccccCCCcc
Confidence 4566655552 2235666777776667 66666668999999883321 11122 1124557
Q ss_pred eEEEEEecCCCEEEEEeCCCcEEEEeCCC---CeEEEE-----ee---cCCCCeeEEEEccCCCEEEE-ecCc--EEEEE
Q 036605 76 LAGLAFAKKGRSLHVVGTNGMASEMKSEM---GEVIRE-----FK---ASEKPISSSAFLCEEKIFAL-ASSE--VRILS 141 (340)
Q Consensus 76 v~~v~~~~~~~~l~s~~~dg~i~~wd~~~---~~~~~~-----~~---~~~~~i~~l~~~~~~~~l~~-~~~~--i~i~d 141 (340)
+-.++|++.++.|+.+-...-..+|.+.. ...+.. +. ..-..+++++++|....|+. .+.. |..+|
T Consensus 120 ~EGla~D~~~~~L~v~kE~~P~~l~~~~~~~~~~~~~~~~~~~~~~~~~~~~d~S~l~~~p~t~~lliLS~es~~l~~~d 199 (248)
T PF06977_consen 120 FEGLAYDPKTNRLFVAKERKPKRLYEVNGFPGGFDLFVSDDQDLDDDKLFVRDLSGLSYDPRTGHLLILSDESRLLLELD 199 (248)
T ss_dssp -EEEEEETTTTEEEEEEESSSEEEEEEESTT-SS--EEEE-HHHH-HT--SS---EEEEETTTTEEEEEETTTTEEEEE-
T ss_pred eEEEEEcCCCCEEEEEeCCCChhhEEEccccCccceeeccccccccccceeccccceEEcCCCCeEEEEECCCCeEEEEC
Confidence 89999999888888876665555554432 111111 11 12345789999997655544 3333 88888
Q ss_pred CCCCceeEEeecCC---------CCeEEEEECCCCCEEEEEEcCCCeEEEE
Q 036605 142 LENGEEVLKFSDDV---------GPLQYVSASDGAKIIITAGYGEKHLQVW 183 (340)
Q Consensus 142 ~~~~~~~~~~~~~~---------~~v~~~~~s~~~~~l~s~~~~d~~i~iw 183 (340)
.+|+.+..+.-.. ...-.|+|.++|+..++ +. -+..++|
T Consensus 200 -~~G~~~~~~~L~~g~~gl~~~~~QpEGIa~d~~G~LYIv-sE-pNlfy~f 247 (248)
T PF06977_consen 200 -RQGRVVSSLSLDRGFHGLSKDIPQPEGIAFDPDGNLYIV-SE-PNLFYRF 247 (248)
T ss_dssp -TT--EEEEEE-STTGGG-SS---SEEEEEE-TT--EEEE-ET-TTEEEEE
T ss_pred -CCCCEEEEEEeCCcccCcccccCCccEEEECCCCCEEEE-cC-CceEEEe
Confidence 5665554442221 34678999999966555 56 5555554
No 400
>TIGR03074 PQQ_membr_DH membrane-bound PQQ-dependent dehydrogenase, glucose/quinate/shikimate family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Members of this family have several predicted transmembrane helices in the N-terminal region, and include the quinoprotein glucose dehydrogenase (EC 1.1.5.2) of Escherichia coli and the quinate/shikimate dehydrogenase of Acinetobacter sp. ADP1 (EC 1.1.99.25). Sequences closely related except for the absense of the N-terminal hydrophobic region, scoring in the gray zone between the trusted and noise cutoffs, include PQQ-dependent glycerol (EC 1.1.99.22) and and other polyol (sugar alcohol) dehydrogenases.
Probab=95.76 E-value=2.1 Score=41.46 Aligned_cols=144 Identities=16% Similarity=0.192 Sum_probs=83.9
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeE-------------EEEEec--CCCEEEEEeC----------CCcEE
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLA-------------GLAFAK--KGRSLHVVGT----------NGMAS 98 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~-------------~v~~~~--~~~~l~s~~~----------dg~i~ 98 (340)
.++.++.|+.+.-.|.++|+..+.+.. .+.|. .+.-.| .+..++.++. +|.|+
T Consensus 262 rV~~~T~Dg~LiALDA~TGk~~W~fg~--~G~vdl~~~~g~~~~g~~~~ts~P~V~~g~VIvG~~v~d~~~~~~~~G~I~ 339 (764)
T TIGR03074 262 RIILPTSDARLIALDADTGKLCEDFGN--NGTVDLTAGMGTTPPGYYYPTSPPLVAGTTVVIGGRVADNYSTDEPSGVIR 339 (764)
T ss_pred EEEEecCCCeEEEEECCCCCEEEEecC--CCceeeecccCcCCCcccccccCCEEECCEEEEEecccccccccCCCcEEE
Confidence 688899999999999999998887642 22221 111111 1345666643 68899
Q ss_pred EEeCCCCeEEEEeecCC---------C--------Ce-eEEEEccCCCEEEEec--------------------CcEEEE
Q 036605 99 EMKSEMGEVIREFKASE---------K--------PI-SSSAFLCEEKIFALAS--------------------SEVRIL 140 (340)
Q Consensus 99 ~wd~~~~~~~~~~~~~~---------~--------~i-~~l~~~~~~~~l~~~~--------------------~~i~i~ 140 (340)
-+|..+|+.+..+.... . .+ ..+++.++...++... +.|.-.
T Consensus 340 A~Da~TGkl~W~~~~g~p~~~~~~~~g~~~~~gg~n~W~~~s~D~~~glvy~ptGn~~pd~~g~~r~~~~n~y~~slvAL 419 (764)
T TIGR03074 340 AFDVNTGALVWAWDPGNPDPTAPPAPGETYTRNTPNSWSVASYDEKLGLVYLPMGNQTPDQWGGDRTPADEKYSSSLVAL 419 (764)
T ss_pred EEECCCCcEeeEEecCCCCcccCCCCCCEeccCCCCccCceEEcCCCCeEEEeCCCccccccCCccccCcccccceEEEE
Confidence 99999999988765210 0 01 1234444444443311 117778
Q ss_pred ECCCCceeEEeecCCCCeE---------EEEECC-CCC---EEEEEEcCCCeEEEEEccCCCCCc
Q 036605 141 SLENGEEVLKFSDDVGPLQ---------YVSASD-GAK---IIITAGYGEKHLQVWRCDISSKTV 192 (340)
Q Consensus 141 d~~~~~~~~~~~~~~~~v~---------~~~~s~-~~~---~l~s~~~~d~~i~iwd~~~~~~~~ 192 (340)
|.++|+..-.++.....+. -+.+.. +|+ .++. +..+|.+.+.|- .+++.
T Consensus 420 D~~TGk~~W~~Q~~~hD~WD~D~~~~p~L~d~~~~~G~~~~~v~~-~~K~G~~~vlDr--~tG~~ 481 (764)
T TIGR03074 420 DATTGKERWVFQTVHHDLWDMDVPAQPSLVDLPDADGTTVPALVA-PTKQGQIYVLDR--RTGEP 481 (764)
T ss_pred eCCCCceEEEecccCCccccccccCCceEEeeecCCCcEeeEEEE-ECCCCEEEEEEC--CCCCE
Confidence 8889988766643221111 112222 453 4555 444899999987 45543
No 401
>PF15390 DUF4613: Domain of unknown function (DUF4613)
Probab=95.75 E-value=0.98 Score=41.15 Aligned_cols=117 Identities=11% Similarity=0.038 Sum_probs=71.5
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEcc-----CCeeEEE----ecCCCCCCeEEEEEecCCCEEEEEe
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVL-----TGEMKWK----STGRHPGGLAGLAFAKKGRSLHVVG 92 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~-----~~~~~~~----~~~~h~~~v~~v~~~~~~~~l~s~~ 92 (340)
+-|..+.|+|-+. .+...|.+......|.+|.+. .++.+.. +....+---.++.|+|....|+.-.
T Consensus 57 EhV~GlsW~P~~~-----~~~paLLAVQHkkhVtVWqL~~s~~e~~K~l~sQtcEi~e~~pvLpQGCVWHPk~~iL~VLT 131 (671)
T PF15390_consen 57 EHVHGLSWAPPCT-----ADTPALLAVQHKKHVTVWQLCPSTTERNKLLMSQTCEIREPFPVLPQGCVWHPKKAILTVLT 131 (671)
T ss_pred ceeeeeeecCccc-----CCCCceEEEeccceEEEEEeccCccccccceeeeeeeccCCcccCCCcccccCCCceEEEEe
Confidence 4688999998763 112234555567789999875 2222211 1110111124678999888777655
Q ss_pred CCCcEEEEeCCCC--eEEEEeecCCCCeeEEEEccCCCEEEEecCc---EEEEECCC
Q 036605 93 TNGMASEMKSEMG--EVIREFKASEKPISSSAFLCEEKIFALASSE---VRILSLEN 144 (340)
Q Consensus 93 ~dg~i~~wd~~~~--~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~---i~i~d~~~ 144 (340)
....-.++++... +....++ ..+.|+|.+|.+||+.|+++-+. -++||-..
T Consensus 132 ~~dvSV~~sV~~d~srVkaDi~-~~G~IhCACWT~DG~RLVVAvGSsLHSyiWd~~q 187 (671)
T PF15390_consen 132 ARDVSVLPSVHCDSSRVKADIK-TSGLIHCACWTKDGQRLVVAVGSSLHSYIWDSAQ 187 (671)
T ss_pred cCceeEeeeeeeCCceEEEecc-CCceEEEEEecCcCCEEEEEeCCeEEEEEecCch
Confidence 5444445554433 3333443 46789999999999999886555 78888543
No 402
>PF02897 Peptidase_S9_N: Prolyl oligopeptidase, N-terminal beta-propeller domain; InterPro: IPR004106 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This entry represents the beta-propeller domain found at the N-terminal of prolyl oligopeptidase, including acylamino-acid-releasing enzyme (also known as acylaminoacyl peptidase), which belong to the MEROPS peptidase family S9 (clan SC), subfamily S9A. The prolyl oligopeptidase family consist of a number of evolutionary related peptidases whose catalytic activity seems to be provided by a charge relay system similar to that of the trypsin family of serine proteases, but which evolved by independent convergent evolution. The N-terminal domain of prolyl oligopeptidases form an unusual 7-bladed beta-propeller consisting of seven 4-stranded beta-sheet motifs. Prolyl oligopeptidase is a large cytosolic enzyme involved in the maturation and degradation of peptide hormones and neuropeptides, which relate to the induction of amnesia. The enzyme contains a peptidase domain, where its catalytic triad (Ser554, His680, Asp641) is covered by the central tunnel of the N-terminal beta-propeller domain. In this way, large structured peptides are excluded from the active site, thereby protecting larger peptides and proteins from proteolysis in the cytosol []. The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. Mammalian acylaminoacyl peptidase is an exopeptidase that is a member of the same prolyl oligopeptidase family of serine peptidases. This enzyme removes acylated amino acid residues from the N terminus of oligopeptides [].; GO: 0004252 serine-type endopeptidase activity, 0006508 proteolysis; PDB: 2BKL_B 3DDU_A 1YR2_A 2XE4_A 1VZ3_A 3EQ9_A 1O6F_A 3EQ7_A 4AN0_A 1UOP_A ....
Probab=95.69 E-value=1.5 Score=39.28 Aligned_cols=171 Identities=10% Similarity=0.104 Sum_probs=86.0
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCC----------CcEEEEEccCCee--EEEe
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSN----------GDILAVDVLTGEM--KWKS 68 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~d----------g~i~i~d~~~~~~--~~~~ 68 (340)
|+|+.+|+.+..-.+ ......+.|.++++ .++.+...+ ..|+.|.+.++.. ...+
T Consensus 154 v~Dl~tg~~l~d~i~-----~~~~~~~~W~~d~~--------~~~y~~~~~~~~~~~~~~~~~v~~~~~gt~~~~d~lvf 220 (414)
T PF02897_consen 154 VFDLETGKFLPDGIE-----NPKFSSVSWSDDGK--------GFFYTRFDEDQRTSDSGYPRQVYRHKLGTPQSEDELVF 220 (414)
T ss_dssp EEETTTTEEEEEEEE-----EEESEEEEECTTSS--------EEEEEECSTTTSS-CCGCCEEEEEEETTS-GGG-EEEE
T ss_pred EEECCCCcCcCCccc-----ccccceEEEeCCCC--------EEEEEEeCcccccccCCCCcEEEEEECCCChHhCeeEE
Confidence 357777766543210 11223499999986 134444332 2377777766542 2334
Q ss_pred cCCCCCC-eEEEEEecCCCEEEEEeCC----CcEEEEeCCCC----eEEEEeecCCCCe-eEEEEccCCCEEEEecCc--
Q 036605 69 TGRHPGG-LAGLAFAKKGRSLHVVGTN----GMASEMKSEMG----EVIREFKASEKPI-SSSAFLCEEKIFALASSE-- 136 (340)
Q Consensus 69 ~~~h~~~-v~~v~~~~~~~~l~s~~~d----g~i~~wd~~~~----~~~~~~~~~~~~i-~~l~~~~~~~~l~~~~~~-- 136 (340)
....... ...+..++|+++|+..... ..+.+.++..+ .....+......+ ..+... .+.+++..+..
T Consensus 221 e~~~~~~~~~~~~~s~d~~~l~i~~~~~~~~s~v~~~d~~~~~~~~~~~~~l~~~~~~~~~~v~~~-~~~~yi~Tn~~a~ 299 (414)
T PF02897_consen 221 EEPDEPFWFVSVSRSKDGRYLFISSSSGTSESEVYLLDLDDGGSPDAKPKLLSPREDGVEYYVDHH-GDRLYILTNDDAP 299 (414)
T ss_dssp C-TTCTTSEEEEEE-TTSSEEEEEEESSSSEEEEEEEECCCTTTSS-SEEEEEESSSS-EEEEEEE-TTEEEEEE-TT-T
T ss_pred eecCCCcEEEEEEecCcccEEEEEEEccccCCeEEEEeccccCCCcCCcEEEeCCCCceEEEEEcc-CCEEEEeeCCCCC
Confidence 4322333 6788899999987754322 35788888764 1222333333333 334333 44444443322
Q ss_pred ---EEEEECCCCce---eEEeecCCCCeEEEEECCCCCEEEEEEcCCC--eEEEEEc
Q 036605 137 ---VRILSLENGEE---VLKFSDDVGPLQYVSASDGAKIIITAGYGEK--HLQVWRC 185 (340)
Q Consensus 137 ---i~i~d~~~~~~---~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~--~i~iwd~ 185 (340)
|...++..... ...+..+...+.-..+...+.+|+.....++ .|.++++
T Consensus 300 ~~~l~~~~l~~~~~~~~~~~l~~~~~~~~l~~~~~~~~~Lvl~~~~~~~~~l~v~~~ 356 (414)
T PF02897_consen 300 NGRLVAVDLADPSPAEWWTVLIPEDEDVSLEDVSLFKDYLVLSYRENGSSRLRVYDL 356 (414)
T ss_dssp T-EEEEEETTSTSGGGEEEEEE--SSSEEEEEEEEETTEEEEEEEETTEEEEEEEET
T ss_pred CcEEEEecccccccccceeEEcCCCCceeEEEEEEECCEEEEEEEECCccEEEEEEC
Confidence 66677776652 2244555543333333334556665554344 5677776
No 403
>KOG4441 consensus Proteins containing BTB/POZ and Kelch domains, involved in regulatory/signal transduction processes [Signal transduction mechanisms; General function prediction only]
Probab=95.68 E-value=0.95 Score=42.29 Aligned_cols=101 Identities=14% Similarity=0.100 Sum_probs=54.1
Q ss_pred EEEEEcCC------CcEEEEEccCCeeEEEecCCCCCCe-EEEEEecCCCEEEEEeCCC-----cEEEEeCCCCeEEEEe
Q 036605 44 LLALGTSN------GDILAVDVLTGEMKWKSTGRHPGGL-AGLAFAKKGRSLHVVGTNG-----MASEMKSEMGEVIREF 111 (340)
Q Consensus 44 ~l~~g~~d------g~i~i~d~~~~~~~~~~~~~h~~~v-~~v~~~~~~~~l~s~~~dg-----~i~~wd~~~~~~~~~~ 111 (340)
+.++|+.| .++..||..+.+... +..-..... .+++. -+|...+.||.|| .|..||..+.+--..
T Consensus 335 lYv~GG~~~~~~~l~~ve~YD~~~~~W~~-~a~M~~~R~~~~v~~-l~g~iYavGG~dg~~~l~svE~YDp~~~~W~~v- 411 (571)
T KOG4441|consen 335 LYVVGGYDSGSDRLSSVERYDPRTNQWTP-VAPMNTKRSDFGVAV-LDGKLYAVGGFDGEKSLNSVECYDPVTNKWTPV- 411 (571)
T ss_pred EEEEccccCCCcccceEEEecCCCCceec-cCCccCccccceeEE-ECCEEEEEeccccccccccEEEecCCCCccccc-
Confidence 78888888 367789988876332 221011111 12221 2577778888885 477888776542111
Q ss_pred ecCCCCeeEEEEc-cCCCEEEEecCc--------EEEEECCCCce
Q 036605 112 KASEKPISSSAFL-CEEKIFALASSE--------VRILSLENGEE 147 (340)
Q Consensus 112 ~~~~~~i~~l~~~-~~~~~l~~~~~~--------i~i~d~~~~~~ 147 (340)
..........+.. -+|++.++++.+ +..||..+++-
T Consensus 412 a~m~~~r~~~gv~~~~g~iYi~GG~~~~~~~l~sve~YDP~t~~W 456 (571)
T KOG4441|consen 412 APMLTRRSGHGVAVLGGKLYIIGGGDGSSNCLNSVECYDPETNTW 456 (571)
T ss_pred CCCCcceeeeEEEEECCEEEEEcCcCCCccccceEEEEcCCCCce
Confidence 1111122333222 345555555522 88899887643
No 404
>KOG2444 consensus WD40 repeat protein [General function prediction only]
Probab=95.62 E-value=0.028 Score=44.32 Aligned_cols=138 Identities=11% Similarity=0.095 Sum_probs=67.4
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEE-EEeecCCCCeeE-E
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVI-REFKASEKPISS-S 121 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~-~~~~~~~~~i~~-l 121 (340)
+|..-+.+|.|.-+++..-+...+-..-|...-..+. -+..++.|+.+|.|.+|...--... ..+......|.+ |
T Consensus 32 ~l~~~sa~~~v~~~~~~k~k~s~rse~~~~e~~~v~~---~~~~~~vG~~dg~v~~~n~n~~g~~~d~~~s~~e~i~~~I 108 (238)
T KOG2444|consen 32 LLRATSADGLVRERKVRKHKESCRSERFIDEGQRVVT---ASAKLMVGTSDGAVYVFNWNLEGAHSDRVCSGEESIDLGI 108 (238)
T ss_pred hhccccCCcccccchhhhhhhhhhhhhhhhcceeecc---cCceEEeecccceEEEecCCccchHHHhhhcccccceecc
Confidence 3444556777777766544322222111222211222 2457899999999999987621111 111111222222 2
Q ss_pred EEccCCCEEEE--ecCcEEEEECCCCceeEEeecCC-CCeEEEEECCCCCEEEEE--EcCCCeEEEEEc
Q 036605 122 AFLCEEKIFAL--ASSEVRILSLENGEEVLKFSDDV-GPLQYVSASDGAKIIITA--GYGEKHLQVWRC 185 (340)
Q Consensus 122 ~~~~~~~~l~~--~~~~i~i~d~~~~~~~~~~~~~~-~~v~~~~~s~~~~~l~s~--~~~d~~i~iwd~ 185 (340)
....++.+..+ .++.|+.|+..-++.+.....|. .++.....+..+.++..+ +. |..++.|++
T Consensus 109 p~~~~~~~~c~~~~dg~ir~~n~~p~k~~g~~g~h~~~~~e~~ivv~sd~~i~~a~~S~-d~~~k~W~v 176 (238)
T KOG2444|consen 109 PNGRDSSLGCVGAQDGRIRACNIKPNKVLGYVGQHNFESGEELIVVGSDEFLKIADTSH-DRVLKKWNV 176 (238)
T ss_pred ccccccceeEEeccCCceeeeccccCceeeeeccccCCCcceeEEecCCceEEeecccc-chhhhhcch
Confidence 22233334433 44459999988877666555555 333333333334444443 23 445555554
No 405
>PHA02713 hypothetical protein; Provisional
Probab=95.53 E-value=0.82 Score=42.69 Aligned_cols=134 Identities=12% Similarity=0.115 Sum_probs=66.4
Q ss_pred EEEEEcCCC-----cEEEEEccCCeeEEEecCCCCCCe--EEEEEecCCCEEEEEeCCC---------------------
Q 036605 44 LLALGTSNG-----DILAVDVLTGEMKWKSTGRHPGGL--AGLAFAKKGRSLHVVGTNG--------------------- 95 (340)
Q Consensus 44 ~l~~g~~dg-----~i~i~d~~~~~~~~~~~~~h~~~v--~~v~~~~~~~~l~s~~~dg--------------------- 95 (340)
+.+.|+.++ ++..||..+.+... +.. -..+. .+++ .-++...+.||.++
T Consensus 354 IYviGG~~~~~~~~sve~Ydp~~~~W~~-~~~-mp~~r~~~~~~-~~~g~IYviGG~~~~~~~~~~~~~~~~~~~~~~~~ 430 (557)
T PHA02713 354 IYAIGGQNGTNVERTIECYTMGDDKWKM-LPD-MPIALSSYGMC-VLDQYIYIIGGRTEHIDYTSVHHMNSIDMEEDTHS 430 (557)
T ss_pred EEEECCcCCCCCCceEEEEECCCCeEEE-CCC-CCcccccccEE-EECCEEEEEeCCCcccccccccccccccccccccc
Confidence 777777654 47889988775332 111 11111 1112 22566666676542
Q ss_pred --cEEEEeCCCCeEEEE--eecCCCCeeEEEEccCCCEEEEecC--------cEEEEECCC-Cce--eEEeecCCCCeEE
Q 036605 96 --MASEMKSEMGEVIRE--FKASEKPISSSAFLCEEKIFALASS--------EVRILSLEN-GEE--VLKFSDDVGPLQY 160 (340)
Q Consensus 96 --~i~~wd~~~~~~~~~--~~~~~~~i~~l~~~~~~~~l~~~~~--------~i~i~d~~~-~~~--~~~~~~~~~~v~~ 160 (340)
.+..||+.+.+-... +...... .+++ .-++++.+.|+. .+..||..+ .+- +..+.........
T Consensus 431 ~~~ve~YDP~td~W~~v~~m~~~r~~-~~~~-~~~~~IYv~GG~~~~~~~~~~ve~Ydp~~~~~W~~~~~m~~~r~~~~~ 508 (557)
T PHA02713 431 SNKVIRYDTVNNIWETLPNFWTGTIR-PGVV-SHKDDIYVVCDIKDEKNVKTCIFRYNTNTYNGWELITTTESRLSALHT 508 (557)
T ss_pred cceEEEECCCCCeEeecCCCCccccc-CcEE-EECCEEEEEeCCCCCCccceeEEEecCCCCCCeeEccccCccccccee
Confidence 477788876543211 1111111 1222 234555555542 167888886 432 2223222222333
Q ss_pred EEECCCCCEEEEEEcCCC--eEEEEEc
Q 036605 161 VSASDGAKIIITAGYGEK--HLQVWRC 185 (340)
Q Consensus 161 ~~~s~~~~~l~s~~~~d~--~i~iwd~ 185 (340)
+.+ +++..++||. ++ .+..||.
T Consensus 509 ~~~--~~~iyv~Gg~-~~~~~~e~yd~ 532 (557)
T PHA02713 509 ILH--DNTIMMLHCY-ESYMLQDTFNV 532 (557)
T ss_pred EEE--CCEEEEEeee-cceeehhhcCc
Confidence 333 5666677666 66 6677776
No 406
>PF10647 Gmad1: Lipoprotein LpqB beta-propeller domain; InterPro: IPR018910 The Gmad1 domain is found associated with IPR019606 from INTERPRO, in bacterial spore formation. It is predicted to have a beta-propeller fold and to have a passive binding role rather than a catalytic function owing to the low number of conserved hydrophilic residues.
Probab=95.36 E-value=1.3 Score=36.59 Aligned_cols=147 Identities=14% Similarity=0.102 Sum_probs=87.7
Q ss_pred CCeEEEEeeccccccccccCceEEEEEc---CCCcEEEEEccCCeeEEEe-cCCCCCCeEEEEEecCCCEEEEEeCCCcE
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGT---SNGDILAVDVLTGEMKWKS-TGRHPGGLAGLAFAKKGRSLHVVGTNGMA 97 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~---~dg~i~i~d~~~~~~~~~~-~~~h~~~v~~v~~~~~~~~l~s~~~dg~i 97 (340)
..+...+++++++ .+|... ....++++. .+.....+ .+ ..+....|++++...+....+...
T Consensus 24 ~~~~s~AvS~dg~---------~~A~v~~~~~~~~L~~~~--~~~~~~~~~~g---~~l~~PS~d~~g~~W~v~~~~~~~ 89 (253)
T PF10647_consen 24 YDVTSPAVSPDGS---------RVAAVSEGDGGRSLYVGP--AGGPVRPVLTG---GSLTRPSWDPDGWVWTVDDGSGGV 89 (253)
T ss_pred ccccceEECCCCC---------eEEEEEEcCCCCEEEEEc--CCCcceeeccC---CccccccccCCCCEEEEEcCCCce
Confidence 3788999999997 555544 334455554 33323332 33 378888999997766665555566
Q ss_pred EEEe-CCCCeEE-EEeec--CCCCeeEEEEccCCCEEEE-e----cCcEEEEECC---CC--cee----EEeecCCCCeE
Q 036605 98 SEMK-SEMGEVI-REFKA--SEKPISSSAFLCEEKIFAL-A----SSEVRILSLE---NG--EEV----LKFSDDVGPLQ 159 (340)
Q Consensus 98 ~~wd-~~~~~~~-~~~~~--~~~~i~~l~~~~~~~~l~~-~----~~~i~i~d~~---~~--~~~----~~~~~~~~~v~ 159 (340)
.++. ..++... ..+.. ....|..+.++|||..++. . ++.|.+--+. .+ ..+ .........+.
T Consensus 90 ~~~~~~~~g~~~~~~v~~~~~~~~I~~l~vSpDG~RvA~v~~~~~~~~v~va~V~r~~~g~~~~l~~~~~~~~~~~~~v~ 169 (253)
T PF10647_consen 90 RVVRDSASGTGEPVEVDWPGLRGRITALRVSPDGTRVAVVVEDGGGGRVYVAGVVRDGDGVPRRLTGPRRVAPPLLSDVT 169 (253)
T ss_pred EEEEecCCCcceeEEecccccCCceEEEEECCCCcEEEEEEecCCCCeEEEEEEEeCCCCCcceeccceEecccccCcce
Confidence 6663 3333322 12221 1227999999999998866 2 3445555432 22 111 11123346789
Q ss_pred EEEECCCCCEEEEEEcCCCeEEE
Q 036605 160 YVSASDGAKIIITAGYGEKHLQV 182 (340)
Q Consensus 160 ~~~~s~~~~~l~s~~~~d~~i~i 182 (340)
.+.|.+++..++.+...+..+..
T Consensus 170 ~v~W~~~~~L~V~~~~~~~~~~~ 192 (253)
T PF10647_consen 170 DVAWSDDSTLVVLGRSAGGPVVR 192 (253)
T ss_pred eeeecCCCEEEEEeCCCCCceeE
Confidence 99999999887776665554444
No 407
>PLN00033 photosystem II stability/assembly factor; Provisional
Probab=95.34 E-value=1.9 Score=38.25 Aligned_cols=143 Identities=14% Similarity=0.136 Sum_probs=82.0
Q ss_pred EEEEeeccccccccccCceEEEEEcCCCcEE-EEEccCCeeE-EEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeC
Q 036605 25 SCLACGFVGKKRRKERGTLLLALGTSNGDIL-AVDVLTGEMK-WKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKS 102 (340)
Q Consensus 25 ~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~-i~d~~~~~~~-~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~ 102 (340)
..+..++++. ++++|. .|.+. -|| .|... ..+.......+..+.|.+++..+++ +.+|.+.. ..
T Consensus 242 ~~v~~~~dG~---------~~~vg~-~G~~~~s~d--~G~~~W~~~~~~~~~~l~~v~~~~dg~l~l~-g~~G~l~~-S~ 307 (398)
T PLN00033 242 STVNRSPDGD---------YVAVSS-RGNFYLTWE--PGQPYWQPHNRASARRIQNMGWRADGGLWLL-TRGGGLYV-SK 307 (398)
T ss_pred eeEEEcCCCC---------EEEEEC-CccEEEecC--CCCcceEEecCCCccceeeeeEcCCCCEEEE-eCCceEEE-ec
Confidence 3345566776 555554 44433 343 44322 1222224557899999988887765 45666543 33
Q ss_pred CCCe-----EEEEeec--CCCCeeEEEEccCCCEEEEecCcEEEEECCCCceeEEee---cCCCCeEEEEECCCCCEEEE
Q 036605 103 EMGE-----VIREFKA--SEKPISSSAFLCEEKIFALASSEVRILSLENGEEVLKFS---DDVGPLQYVSASDGAKIIIT 172 (340)
Q Consensus 103 ~~~~-----~~~~~~~--~~~~i~~l~~~~~~~~l~~~~~~i~i~d~~~~~~~~~~~---~~~~~v~~~~~s~~~~~l~s 172 (340)
..++ ....... ....+..+.+.+++..++++..-+.+.....|+.-.... .-......+.|.++++.+++
T Consensus 308 d~G~~~~~~~f~~~~~~~~~~~l~~v~~~~d~~~~a~G~~G~v~~s~D~G~tW~~~~~~~~~~~~ly~v~f~~~~~g~~~ 387 (398)
T PLN00033 308 GTGLTEEDFDFEEADIKSRGFGILDVGYRSKKEAWAAGGSGILLRSTDGGKSWKRDKGADNIAANLYSVKFFDDKKGFVL 387 (398)
T ss_pred CCCCcccccceeecccCCCCcceEEEEEcCCCcEEEEECCCcEEEeCCCCcceeEccccCCCCcceeEEEEcCCCceEEE
Confidence 4443 1222221 223588899999988888766655555555554433322 22356789999887776666
Q ss_pred EEcCCCeEEEE
Q 036605 173 AGYGEKHLQVW 183 (340)
Q Consensus 173 ~~~~d~~i~iw 183 (340)
+. +|.|.-|
T Consensus 388 -G~-~G~il~~ 396 (398)
T PLN00033 388 -GN-DGVLLRY 396 (398)
T ss_pred -eC-CcEEEEe
Confidence 55 6776544
No 408
>COG3204 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=95.29 E-value=1.4 Score=36.55 Aligned_cols=165 Identities=12% Similarity=0.187 Sum_probs=97.1
Q ss_pred CCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecC-CCCeeEEEEccCCCEEEEecCc--EEEEECCCCcee
Q 036605 72 HPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKAS-EKPISSSAFLCEEKIFALASSE--VRILSLENGEEV 148 (340)
Q Consensus 72 h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~-~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~ 148 (340)
-...+.++.|+|+.+.|++......-.++=-..|+.+.++... -.....|.+..+++++++--++ +.++.+.....+
T Consensus 84 ~~~nvS~LTynp~~rtLFav~n~p~~iVElt~~GdlirtiPL~g~~DpE~Ieyig~n~fvi~dER~~~l~~~~vd~~t~~ 163 (316)
T COG3204 84 ETANVSSLTYNPDTRTLFAVTNKPAAIVELTKEGDLIRTIPLTGFSDPETIEYIGGNQFVIVDERDRALYLFTVDADTTV 163 (316)
T ss_pred ccccccceeeCCCcceEEEecCCCceEEEEecCCceEEEecccccCChhHeEEecCCEEEEEehhcceEEEEEEcCCccE
Confidence 3445999999999999999888877777766778888775421 2234677888888887775444 666655443221
Q ss_pred E-----Ee----ecC-CCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeec-CC-Ceeeeeec-CCCC
Q 036605 149 L-----KF----SDD-VGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMR-HS-PVAIDCKN-SPNG 215 (340)
Q Consensus 149 ~-----~~----~~~-~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~-~~-~~~~~~~~-~~~~ 215 (340)
. ++ ..+ ......++|+|....|+.+-. -+-+.||.+................ .. -.+.++.. .+..
T Consensus 164 ~~~~~~~i~L~~~~k~N~GfEGlA~d~~~~~l~~aKE-r~P~~I~~~~~~~~~l~~~~~~~~~~~~~~f~~DvSgl~~~~ 242 (316)
T COG3204 164 ISAKVQKIPLGTTNKKNKGFEGLAWDPVDHRLFVAKE-RNPIGIFEVTQSPSSLSVHASLDPTADRDLFVLDVSGLEFNA 242 (316)
T ss_pred EeccceEEeccccCCCCcCceeeecCCCCceEEEEEc-cCCcEEEEEecCCcccccccccCcccccceEeeccccceecC
Confidence 1 11 112 445678999999888888665 7778888773111111111110000 00 11222211 1223
Q ss_pred CCCCEEEEEeCCCcEEEEECCC
Q 036605 216 EDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 216 ~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
..+..++-+.+++.+.-.|...
T Consensus 243 ~~~~LLVLS~ESr~l~Evd~~G 264 (316)
T COG3204 243 ITNSLLVLSDESRRLLEVDLSG 264 (316)
T ss_pred CCCcEEEEecCCceEEEEecCC
Confidence 4566666666777666666543
No 409
>PF07250 Glyoxal_oxid_N: Glyoxal oxidase N-terminus; InterPro: IPR009880 This entry represents the N terminus (approximately 300 residues) of a number of plant and fungal glyoxal oxidase enzymes. Glyoxal oxidase catalyses the oxidation of aldehydes to carboxylic acids, coupled with reduction of dioxygen to hydrogen peroxide. It is an essential component of the extracellular lignin degradation pathways of the wood-rot fungus Phanerochaete chrysosporium [].
Probab=95.14 E-value=0.3 Score=39.82 Aligned_cols=143 Identities=18% Similarity=0.120 Sum_probs=82.9
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCC---CcEEEEEccCC--eeEEE-ecC--CC
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSN---GDILAVDVLTG--EMKWK-STG--RH 72 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~d---g~i~i~d~~~~--~~~~~-~~~--~h 72 (340)
+||+.+++....-. ....-|..-.+-|||+ +|.+|+.. ..+++++.... ...+. ... ..
T Consensus 50 ~yD~~tn~~rpl~v----~td~FCSgg~~L~dG~---------ll~tGG~~~G~~~ir~~~p~~~~~~~~w~e~~~~m~~ 116 (243)
T PF07250_consen 50 EYDPNTNTFRPLTV----QTDTFCSGGAFLPDGR---------LLQTGGDNDGNKAIRIFTPCTSDGTCDWTESPNDMQS 116 (243)
T ss_pred EEecCCCcEEeccC----CCCCcccCcCCCCCCC---------EEEeCCCCccccceEEEecCCCCCCCCceECcccccC
Confidence 47888777653222 3445666677889999 88887753 35778876541 11111 000 01
Q ss_pred CCCeEEEEEecCCCEEEEEeCCC-cEEEEeCCC-CeEEEEe--ec------CCCCeeEEEEccCCCEEEEecCcEEEEEC
Q 036605 73 PGGLAGLAFAKKGRSLHVVGTNG-MASEMKSEM-GEVIREF--KA------SEKPISSSAFLCEEKIFALASSEVRILSL 142 (340)
Q Consensus 73 ~~~v~~v~~~~~~~~l~s~~~dg-~i~~wd~~~-~~~~~~~--~~------~~~~i~~l~~~~~~~~l~~~~~~i~i~d~ 142 (340)
..-=....--+||+.|+.|+... ....|.... ......+ -. ...-.-.+.+.|+|++++.+...-.|||.
T Consensus 117 ~RWYpT~~~L~DG~vlIvGG~~~~t~E~~P~~~~~~~~~~~~~l~~~~~~~~~nlYP~~~llPdG~lFi~an~~s~i~d~ 196 (243)
T PF07250_consen 117 GRWYPTATTLPDGRVLIVGGSNNPTYEFWPPKGPGPGPVTLPFLSQTSDTLPNNLYPFVHLLPDGNLFIFANRGSIIYDY 196 (243)
T ss_pred CCccccceECCCCCEEEEeCcCCCcccccCCccCCCCceeeecchhhhccCccccCceEEEcCCCCEEEEEcCCcEEEeC
Confidence 11112333457899999888774 445555422 1111111 10 11112356678999999999999889999
Q ss_pred CCCceeEEeecCCC
Q 036605 143 ENGEEVLKFSDDVG 156 (340)
Q Consensus 143 ~~~~~~~~~~~~~~ 156 (340)
.+.+.++.+..-.+
T Consensus 197 ~~n~v~~~lP~lPg 210 (243)
T PF07250_consen 197 KTNTVVRTLPDLPG 210 (243)
T ss_pred CCCeEEeeCCCCCC
Confidence 99877777755443
No 410
>PHA02790 Kelch-like protein; Provisional
Probab=95.13 E-value=2.6 Score=38.63 Aligned_cols=100 Identities=11% Similarity=0.079 Sum_probs=48.8
Q ss_pred EEEEEcCCC-----cEEEEEccCCeeEEEecCCCCCCe-EEEEEecCCCEEEEEeCC--CcEEEEeCCCCeEEEEeecCC
Q 036605 44 LLALGTSNG-----DILAVDVLTGEMKWKSTGRHPGGL-AGLAFAKKGRSLHVVGTN--GMASEMKSEMGEVIREFKASE 115 (340)
Q Consensus 44 ~l~~g~~dg-----~i~i~d~~~~~~~~~~~~~h~~~v-~~v~~~~~~~~l~s~~~d--g~i~~wd~~~~~~~~~~~~~~ 115 (340)
++++|+.++ .+..||..+++... +..-..... .+++ .-++...+.||.+ ..+..||..+++-.. ...-.
T Consensus 274 lyviGG~~~~~~~~~v~~Ydp~~~~W~~-~~~m~~~r~~~~~v-~~~~~iYviGG~~~~~sve~ydp~~n~W~~-~~~l~ 350 (480)
T PHA02790 274 VYLIGGWMNNEIHNNAIAVNYISNNWIP-IPPMNSPRLYASGV-PANNKLYVVGGLPNPTSVERWFHGDAAWVN-MPSLL 350 (480)
T ss_pred EEEEcCCCCCCcCCeEEEEECCCCEEEE-CCCCCchhhcceEE-EECCEEEEECCcCCCCceEEEECCCCeEEE-CCCCC
Confidence 667777543 57788988765332 221011111 1222 2356666666653 457888876553221 11111
Q ss_pred CCe-eEEEEccCCCEEEEecCc-----EEEEECCCCc
Q 036605 116 KPI-SSSAFLCEEKIFALASSE-----VRILSLENGE 146 (340)
Q Consensus 116 ~~i-~~l~~~~~~~~l~~~~~~-----i~i~d~~~~~ 146 (340)
.+. ......-+|++.+.|+.+ +..||..+.+
T Consensus 351 ~~r~~~~~~~~~g~IYviGG~~~~~~~ve~ydp~~~~ 387 (480)
T PHA02790 351 KPRCNPAVASINNVIYVIGGHSETDTTTEYLLPNHDQ 387 (480)
T ss_pred CCCcccEEEEECCEEEEecCcCCCCccEEEEeCCCCE
Confidence 111 111223356666665532 6778877653
No 411
>PF10313 DUF2415: Uncharacterised protein domain (DUF2415); InterPro: IPR019417 This entry represents a short (30 residues) domain of unknown function found in a family of fungal proteins. It contains a characteristic DLL sequence motif.
Probab=94.92 E-value=0.12 Score=29.10 Aligned_cols=31 Identities=13% Similarity=0.146 Sum_probs=25.3
Q ss_pred CCeEEEEEecCCC---EEEEEeCCCcEEEEeCCC
Q 036605 74 GGLAGLAFAKKGR---SLHVVGTNGMASEMKSEM 104 (340)
Q Consensus 74 ~~v~~v~~~~~~~---~l~s~~~dg~i~~wd~~~ 104 (340)
+.|.++.|+|... +|+.+-.-|.|.++|+++
T Consensus 1 GAvR~~kFsP~~~~~DLL~~~E~~g~vhi~D~R~ 34 (43)
T PF10313_consen 1 GAVRCCKFSPEPGGNDLLAWAEHQGRVHIVDTRS 34 (43)
T ss_pred CCeEEEEeCCCCCcccEEEEEccCCeEEEEEccc
Confidence 4789999998544 777777779999999985
No 412
>PF14870 PSII_BNR: Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=94.85 E-value=2.1 Score=36.26 Aligned_cols=108 Identities=14% Similarity=0.179 Sum_probs=55.7
Q ss_pred CCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE-ecCcEEEEEC-CCCceeE
Q 036605 72 HPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL-ASSEVRILSL-ENGEEVL 149 (340)
Q Consensus 72 h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~-~~~~i~i~d~-~~~~~~~ 149 (340)
-.+.+..+.-+++|++++++.....+.-||.-...-...-......|..+.|.|++.+.+. -++.|+.=+. ...+...
T Consensus 143 ~~gs~~~~~r~~dG~~vavs~~G~~~~s~~~G~~~w~~~~r~~~~riq~~gf~~~~~lw~~~~Gg~~~~s~~~~~~~~w~ 222 (302)
T PF14870_consen 143 TSGSINDITRSSDGRYVAVSSRGNFYSSWDPGQTTWQPHNRNSSRRIQSMGFSPDGNLWMLARGGQIQFSDDPDDGETWS 222 (302)
T ss_dssp ----EEEEEE-TTS-EEEEETTSSEEEEE-TT-SS-EEEE--SSS-EEEEEE-TTS-EEEEETTTEEEEEE-TTEEEEE-
T ss_pred CcceeEeEEECCCCcEEEEECcccEEEEecCCCccceEEccCccceehhceecCCCCEEEEeCCcEEEEccCCCCccccc
Confidence 5578899998999998888766555668875432222222234678999999999887555 4555777662 2221111
Q ss_pred E----eecCCCCeEEEEECCCCCEEEEEEcCCCeEE
Q 036605 150 K----FSDDVGPLQYVSASDGAKIIITAGYGEKHLQ 181 (340)
Q Consensus 150 ~----~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~ 181 (340)
. +......+..++|.+++...++++ .|.+.
T Consensus 223 ~~~~~~~~~~~~~ld~a~~~~~~~wa~gg--~G~l~ 256 (302)
T PF14870_consen 223 EPIIPIKTNGYGILDLAYRPPNEIWAVGG--SGTLL 256 (302)
T ss_dssp --B-TTSS--S-EEEEEESSSS-EEEEES--TT-EE
T ss_pred cccCCcccCceeeEEEEecCCCCEEEEeC--CccEE
Confidence 1 111223478899999887777644 45543
No 413
>KOG2377 consensus Uncharacterized conserved protein [Function unknown]
Probab=94.77 E-value=2.8 Score=37.16 Aligned_cols=114 Identities=11% Similarity=0.084 Sum_probs=76.8
Q ss_pred CCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEE----eecCCCCeeEEEEccCCCEEEEecCcEEEEECCCC-c
Q 036605 72 HPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIRE----FKASEKPISSSAFLCEEKIFALASSEVRILSLENG-E 146 (340)
Q Consensus 72 h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~----~~~~~~~i~~l~~~~~~~~l~~~~~~i~i~d~~~~-~ 146 (340)
..|+|.++.|++|.+.|+.--.+..|.+++....+.... .+.....|....|+.+....+..+.-+-+|..... .
T Consensus 65 d~G~I~SIkFSlDnkilAVQR~~~~v~f~nf~~d~~~l~~~~~ck~k~~~IlGF~W~~s~e~A~i~~~G~e~y~v~pekr 144 (657)
T KOG2377|consen 65 DKGEIKSIKFSLDNKILAVQRTSKTVDFCNFIPDNSQLEYTQECKTKNANILGFCWTSSTEIAFITDQGIEFYQVLPEKR 144 (657)
T ss_pred CCCceeEEEeccCcceEEEEecCceEEEEecCCCchhhHHHHHhccCcceeEEEEEecCeeEEEEecCCeEEEEEchhhh
Confidence 567999999999999999999999999998754443322 23344568888998875444444444767765433 2
Q ss_pred eeEEeecCCCCeEEEEECCCCCEEEEE-EcCCCeEEEEEc
Q 036605 147 EVLKFSDDVGPLQYVSASDGAKIIITA-GYGEKHLQVWRC 185 (340)
Q Consensus 147 ~~~~~~~~~~~v~~~~~s~~~~~l~s~-~~~d~~i~iwd~ 185 (340)
.++....|...|.-..|.++.+.++.+ +...+.+.=+.+
T Consensus 145 slRlVks~~~nvnWy~yc~et~v~LL~t~~~~n~lnpf~~ 184 (657)
T KOG2377|consen 145 SLRLVKSHNLNVNWYMYCPETAVILLSTTVLENVLNPFHF 184 (657)
T ss_pred hhhhhhhcccCccEEEEccccceEeeeccccccccccEEE
Confidence 345556777788888888887654443 323555555555
No 414
>PHA03098 kelch-like protein; Provisional
Probab=94.59 E-value=1.8 Score=40.26 Aligned_cols=137 Identities=8% Similarity=0.009 Sum_probs=63.4
Q ss_pred EEEEEcCC-----CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCC------CcEEEEeCCCCeEEEE--
Q 036605 44 LLALGTSN-----GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTN------GMASEMKSEMGEVIRE-- 110 (340)
Q Consensus 44 ~l~~g~~d-----g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~d------g~i~~wd~~~~~~~~~-- 110 (340)
+++.|+.+ ..+..||..+++....-.-.+...-.+++ .-+++..+.||.+ ..+..||+.+.+-...
T Consensus 345 lyv~GG~~~~~~~~~v~~yd~~~~~W~~~~~lp~~r~~~~~~-~~~~~iYv~GG~~~~~~~~~~v~~yd~~t~~W~~~~~ 423 (534)
T PHA03098 345 IYVIGGIYNSISLNTVESWKPGESKWREEPPLIFPRYNPCVV-NVNNLIYVIGGISKNDELLKTVECFSLNTNKWSKGSP 423 (534)
T ss_pred EEEEeCCCCCEecceEEEEcCCCCceeeCCCcCcCCccceEE-EECCEEEEECCcCCCCcccceEEEEeCCCCeeeecCC
Confidence 67777755 35778888776533211110111111222 2245666666632 3578899876543211
Q ss_pred eecCCCCeeEEEEccCCCEEEEecC----------cEEEEECCCCceeE--EeecCCCCeEEEEECCCCCEEEEEEcC--
Q 036605 111 FKASEKPISSSAFLCEEKIFALASS----------EVRILSLENGEEVL--KFSDDVGPLQYVSASDGAKIIITAGYG-- 176 (340)
Q Consensus 111 ~~~~~~~i~~l~~~~~~~~l~~~~~----------~i~i~d~~~~~~~~--~~~~~~~~v~~~~~s~~~~~l~s~~~~-- 176 (340)
+...... .++ ...++.+++.|+. .+.+||..+++-.. .+.........+.+ ++..++.+|..
T Consensus 424 ~p~~r~~-~~~-~~~~~~iyv~GG~~~~~~~~~~~~v~~yd~~~~~W~~~~~~~~~r~~~~~~~~--~~~iyv~GG~~~~ 499 (534)
T PHA03098 424 LPISHYG-GCA-IYHDGKIYVIGGISYIDNIKVYNIVESYNPVTNKWTELSSLNFPRINASLCIF--NNKIYVVGGDKYE 499 (534)
T ss_pred CCccccC-ceE-EEECCEEEEECCccCCCCCcccceEEEecCCCCceeeCCCCCcccccceEEEE--CCEEEEEcCCcCC
Confidence 1111111 122 2234555555442 17888887764321 11111111122222 55566665542
Q ss_pred --CCeEEEEEc
Q 036605 177 --EKHLQVWRC 185 (340)
Q Consensus 177 --d~~i~iwd~ 185 (340)
.+.+.+||.
T Consensus 500 ~~~~~v~~yd~ 510 (534)
T PHA03098 500 YYINEIEVYDD 510 (534)
T ss_pred cccceeEEEeC
Confidence 246777776
No 415
>PF12234 Rav1p_C: RAVE protein 1 C terminal; InterPro: IPR022033 This domain family is found in eukaryotes, and is typically between 621 and 644 amino acids in length. This family is the C-terminal region of the protein RAVE (regulator of the ATPase of vacuolar and endosomal membranes). Rav1p is involved in regulating the glucose dependent assembly and disassembly of vacuolar ATPase V1 and V0 subunits.
Probab=94.58 E-value=2.9 Score=39.20 Aligned_cols=106 Identities=11% Similarity=0.100 Sum_probs=63.5
Q ss_pred EEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEee-cCCCCeeEEEEc--cCCCEEEEec-C-cEEEEEC-----CC--
Q 036605 77 AGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFK-ASEKPISSSAFL--CEEKIFALAS-S-EVRILSL-----EN-- 144 (340)
Q Consensus 77 ~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~-~~~~~i~~l~~~--~~~~~l~~~~-~-~i~i~d~-----~~-- 144 (340)
.-+.-+.-++..++-+....+.+||...+.....-. .....|..+.|. |+++.+++.+ . .|.+|-- ..
T Consensus 33 ~li~gss~~k~a~V~~~~~~LtIWD~~~~~lE~~~~f~~~~~I~dLDWtst~d~qsiLaVGf~~~v~l~~Q~R~dy~~~~ 112 (631)
T PF12234_consen 33 SLISGSSIKKIAVVDSSRSELTIWDTRSGVLEYEESFSEDDPIRDLDWTSTPDGQSILAVGFPHHVLLYTQLRYDYTNKG 112 (631)
T ss_pred ceEeecccCcEEEEECCCCEEEEEEcCCcEEEEeeeecCCCceeeceeeecCCCCEEEEEEcCcEEEEEEccchhhhcCC
Confidence 333334434444443444678999999887543322 346688888886 6777775533 2 3666642 11
Q ss_pred --CceeEEe--ecCC-CCeEEEEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 145 --GEEVLKF--SDDV-GPLQYVSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 145 --~~~~~~~--~~~~-~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
...+.++ ..|. .+|.+..|.++|..++.+ ++.+.|+|-
T Consensus 113 p~w~~i~~i~i~~~T~h~Igds~Wl~~G~LvV~s---GNqlfv~dk 155 (631)
T PF12234_consen 113 PSWAPIRKIDISSHTPHPIGDSIWLKDGTLVVGS---GNQLFVFDK 155 (631)
T ss_pred cccceeEEEEeecCCCCCccceeEecCCeEEEEe---CCEEEEECC
Confidence 1223333 3343 678999999999655543 468888874
No 416
>PF14655 RAB3GAP2_N: Rab3 GTPase-activating protein regulatory subunit N-terminus
Probab=94.54 E-value=0.77 Score=40.71 Aligned_cols=85 Identities=15% Similarity=0.169 Sum_probs=56.3
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCC-eEEEEEecC-C-----------
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGG-LAGLAFAKK-G----------- 85 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~-v~~v~~~~~-~----------- 85 (340)
.....+.+++.+|+++ +.|+..+-|.|.++|+.++..++-+++ ..+. +.-+..... .
T Consensus 305 D~~R~~~~i~~sP~~~---------laA~tDslGRV~LiD~~~~~vvrmWKG-YRdAqc~wi~~~~~~~~~~~~~~~~~~ 374 (415)
T PF14655_consen 305 DSKREGESICLSPSGR---------LAAVTDSLGRVLLIDVARGIVVRMWKG-YRDAQCGWIEVPEEGDRDRSNSNSPKS 374 (415)
T ss_pred cCCceEEEEEECCCCC---------EEEEEcCCCcEEEEECCCChhhhhhcc-CccceEEEEEeecccccccccccccCC
Confidence 3446688999999999 788877779999999999987777766 3222 111111111 0
Q ss_pred -----C-EEEEEeCCCcEEEEeCCCCeEEEEeec
Q 036605 86 -----R-SLHVVGTNGMASEMKSEMGEVIREFKA 113 (340)
Q Consensus 86 -----~-~l~s~~~dg~i~~wd~~~~~~~~~~~~ 113 (340)
. +++-+-.-|.|.+|.+++|..+..+..
T Consensus 375 ~~~~~l~LvIyaprRg~lEvW~~~~g~Rv~a~~v 408 (415)
T PF14655_consen 375 SSRFALFLVIYAPRRGILEVWSMRQGPRVAAFNV 408 (415)
T ss_pred CCcceEEEEEEeccCCeEEEEecCCCCEEEEEEe
Confidence 1 223345568888888888877766654
No 417
>KOG4441 consensus Proteins containing BTB/POZ and Kelch domains, involved in regulatory/signal transduction processes [Signal transduction mechanisms; General function prediction only]
Probab=94.43 E-value=3.8 Score=38.44 Aligned_cols=140 Identities=15% Similarity=0.124 Sum_probs=70.3
Q ss_pred EEEEEcCC------CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCC------CcEEEEeCCCCeEEEEe
Q 036605 44 LLALGTSN------GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTN------GMASEMKSEMGEVIREF 111 (340)
Q Consensus 44 ~l~~g~~d------g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~d------g~i~~wd~~~~~~~~~~ 111 (340)
++++|+.+ ..+..||..++.......-.+...-.+++.. ++...++||.| ..+..||..+.+-.. +
T Consensus 287 l~~vGG~~~~~~~~~~ve~yd~~~~~w~~~a~m~~~r~~~~~~~~-~~~lYv~GG~~~~~~~l~~ve~YD~~~~~W~~-~ 364 (571)
T KOG4441|consen 287 LVAVGGYNRQGQSLRSVECYDPKTNEWSSLAPMPSPRCRVGVAVL-NGKLYVVGGYDSGSDRLSSVERYDPRTNQWTP-V 364 (571)
T ss_pred EEEECCCCCCCcccceeEEecCCcCcEeecCCCCcccccccEEEE-CCEEEEEccccCCCcccceEEEecCCCCceec-c
Confidence 77777776 3677899888754332221122233455554 45677778887 356788887766221 1
Q ss_pred ecCCCCeeEEEEc-cCCCEEEEecCc-------EEEEECCCCceeEEeecCCCCeEEEEE-CCCCCEEEEEEcC-----C
Q 036605 112 KASEKPISSSAFL-CEEKIFALASSE-------VRILSLENGEEVLKFSDDVGPLQYVSA-SDGAKIIITAGYG-----E 177 (340)
Q Consensus 112 ~~~~~~i~~l~~~-~~~~~l~~~~~~-------i~i~d~~~~~~~~~~~~~~~~v~~~~~-s~~~~~l~s~~~~-----d 177 (340)
..-..+-..+... -+|.+.++|+.+ +-.||..+.+--.. ............ .-+|...+++|.. -
T Consensus 365 a~M~~~R~~~~v~~l~g~iYavGG~dg~~~l~svE~YDp~~~~W~~v-a~m~~~r~~~gv~~~~g~iYi~GG~~~~~~~l 443 (571)
T KOG4441|consen 365 APMNTKRSDFGVAVLDGKLYAVGGFDGEKSLNSVECYDPVTNKWTPV-APMLTRRSGHGVAVLGGKLYIIGGGDGSSNCL 443 (571)
T ss_pred CCccCccccceeEEECCEEEEEeccccccccccEEEecCCCCccccc-CCCCcceeeeEEEEECCEEEEEcCcCCCcccc
Confidence 1111111111221 245566666655 78888776542211 111111122111 2245555565531 1
Q ss_pred CeEEEEEcc
Q 036605 178 KHLQVWRCD 186 (340)
Q Consensus 178 ~~i~iwd~~ 186 (340)
..+..||..
T Consensus 444 ~sve~YDP~ 452 (571)
T KOG4441|consen 444 NSVECYDPE 452 (571)
T ss_pred ceEEEEcCC
Confidence 356777763
No 418
>KOG2280 consensus Vacuolar assembly/sorting protein VPS16 [Intracellular trafficking, secretion, and vesicular transport]
Probab=94.39 E-value=1.6 Score=41.03 Aligned_cols=150 Identities=12% Similarity=0.092 Sum_probs=76.9
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEec---CCCCCCeEEEEEecCCCEEEEEeCCCcEEE
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKST---GRHPGGLAGLAFAKKGRSLHVVGTNGMASE 99 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~---~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~ 99 (340)
++-.+.|+.+.. |++-..+|++++|++.... ..... ......|..+.|..+|-.+. ..+|.+.+
T Consensus 85 ~lI~mgWs~~ee----------LI~v~k~g~v~Vy~~~ge~-ie~~svg~e~~~~~I~ec~~f~~GVavl--t~~g~v~~ 151 (829)
T KOG2280|consen 85 ELIGMGWSDDEE----------LICVQKDGTVHVYGLLGEF-IESNSVGFESQMSDIVECRFFHNGVAVL--TVSGQVIL 151 (829)
T ss_pred CeeeecccCCce----------EEEEeccceEEEeecchhh-hcccccccccccCceeEEEEecCceEEE--ecCCcEEE
Confidence 777899998888 7777899999999975432 22211 11223454444444443333 34455554
Q ss_pred EeCCCCeEEEEeec---CCCCeeEEEEccCCC---EEEEecCc--EEEEECCCCc-eeEEeecCCCCeEEEEECCCCCEE
Q 036605 100 MKSEMGEVIREFKA---SEKPISSSAFLCEEK---IFALASSE--VRILSLENGE-EVLKFSDDVGPLQYVSASDGAKII 170 (340)
Q Consensus 100 wd~~~~~~~~~~~~---~~~~i~~l~~~~~~~---~l~~~~~~--i~i~d~~~~~-~~~~~~~~~~~v~~~~~s~~~~~l 170 (340)
.+-.......++.. ...+-+|-...+++. .++-.+.. ..++...... ....+....+.+..+..||+.++|
T Consensus 152 i~~~~~~~~~~~~diP~~~~~~~~Wt~~~~~~~~~~ll~v~~~v~~~~~q~~~~~~q~~~~~~~~~~~~ki~VS~n~~~l 231 (829)
T KOG2280|consen 152 INGVEEPKLRKMPDIPYNELPKSCWTVFQPHRQSTILLDVDVAVGLHICQVEESRVQLHALSWPNSSVVKISVSPNRRFL 231 (829)
T ss_pred EcCCCcchhhhCCCCCCccCCCcceeEecCCCcceeEEeechhhhhcccceecccccccccCCCCceEEEEEEcCCcceE
Confidence 43222212222221 111223333333322 12212211 1222222211 122333334677889999999998
Q ss_pred EEEEcCCCeEEEEEcc
Q 036605 171 ITAGYGEKHLQVWRCD 186 (340)
Q Consensus 171 ~s~~~~d~~i~iwd~~ 186 (340)
+.-.. .|.|.+-+.+
T Consensus 232 aLyt~-~G~i~~vs~D 246 (829)
T KOG2280|consen 232 ALYTE-TGKIWVVSID 246 (829)
T ss_pred EEEec-CCcEEEEecc
Confidence 88666 8999888874
No 419
>PF10313 DUF2415: Uncharacterised protein domain (DUF2415); InterPro: IPR019417 This entry represents a short (30 residues) domain of unknown function found in a family of fungal proteins. It contains a characteristic DLL sequence motif.
Probab=94.35 E-value=0.17 Score=28.54 Aligned_cols=34 Identities=24% Similarity=0.248 Sum_probs=26.6
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT 61 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~ 61 (340)
+.|.++.|||... ..++|+..-..|.|.|+|+++
T Consensus 1 GAvR~~kFsP~~~------~~DLL~~~E~~g~vhi~D~R~ 34 (43)
T PF10313_consen 1 GAVRCCKFSPEPG------GNDLLAWAEHQGRVHIVDTRS 34 (43)
T ss_pred CCeEEEEeCCCCC------cccEEEEEccCCeEEEEEccc
Confidence 3689999997532 113899999999999999885
No 420
>COG5167 VID27 Protein involved in vacuole import and degradation [Intracellular trafficking and secretion]
Probab=94.17 E-value=2.1 Score=38.44 Aligned_cols=140 Identities=11% Similarity=0.068 Sum_probs=87.7
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCC-------EEEEEeCCCcEEEEeCCCCe-EEE--Eee-
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGR-------SLHVVGTNGMASEMKSEMGE-VIR--EFK- 112 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~-------~l~s~~~dg~i~~wd~~~~~-~~~--~~~- 112 (340)
++..|.....++-.|++.|+.+-.+.- |.. | -+.|.|+.+ .-+.|-.+..|.-.|++-.. .+. .++
T Consensus 482 i~~dg~~~~kLykmDIErGkvveeW~~-~dd-v-vVqy~p~~kf~qmt~eqtlvGlS~~svFrIDPR~~gNKi~v~esKd 558 (776)
T COG5167 482 IYLDGGERDKLYKMDIERGKVVEEWDL-KDD-V-VVQYNPYFKFQQMTDEQTLVGLSDYSVFRIDPRARGNKIKVVESKD 558 (776)
T ss_pred EEecCCCcccceeeecccceeeeEeec-CCc-c-eeecCCchhHHhcCccceEEeecccceEEecccccCCceeeeeehh
Confidence 444566667888889999998888875 543 3 567777432 22334555566666765332 111 121
Q ss_pred -cCCCCeeEEEEccCCCEEEEe--cCcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCC
Q 036605 113 -ASEKPISSSAFLCEEKIFALA--SSEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISS 189 (340)
Q Consensus 113 -~~~~~i~~l~~~~~~~~l~~~--~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~ 189 (340)
..+...++..-..+| +++++ .++|++||--.......+++....|..+..+.+|+++++.+. .++-+-|++...
T Consensus 559 Y~tKn~Fss~~tTesG-yIa~as~kGDirLyDRig~rAKtalP~lG~aIk~idvta~Gk~ilaTCk--~yllL~d~~ik~ 635 (776)
T COG5167 559 YKTKNKFSSGMTTESG-YIAAASRKGDIRLYDRIGKRAKTALPGLGDAIKHIDVTANGKHILATCK--NYLLLTDVPIKY 635 (776)
T ss_pred ccccccccccccccCc-eEEEecCCCceeeehhhcchhhhcCcccccceeeeEeecCCcEEEEeec--ceEEEEeccccc
Confidence 122234444444555 44443 456999995444333455666778999999999999998665 788888885433
No 421
>COG1520 FOG: WD40-like repeat [Function unknown]
Probab=94.06 E-value=3.9 Score=35.99 Aligned_cols=106 Identities=17% Similarity=0.278 Sum_probs=68.0
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCC-CCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCC-CCeeEE
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRH-PGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASE-KPISSS 121 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h-~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~-~~i~~l 121 (340)
.++++..+|.|.-+|..++..++...... ...+.+-.+..+|+ ++.++.+|.+..+|..+|+.+....... -.+..-
T Consensus 70 ~v~~~~~~G~i~A~d~~~g~~~W~~~~~~~~~~~~~~~~~~~G~-i~~g~~~g~~y~ld~~~G~~~W~~~~~~~~~~~~~ 148 (370)
T COG1520 70 TVYVGTRDGNIFALNPDTGLVKWSYPLLGAVAQLSGPILGSDGK-IYVGSWDGKLYALDASTGTLVWSRNVGGSPYYASP 148 (370)
T ss_pred eEEEecCCCcEEEEeCCCCcEEecccCcCcceeccCceEEeCCe-EEEecccceEEEEECCCCcEEEEEecCCCeEEecC
Confidence 37777899999999999998777655311 12333333443565 7778999999999999999888876555 112222
Q ss_pred EEccCCCEEEE-ecCcEEEEECCCCceeEE
Q 036605 122 AFLCEEKIFAL-ASSEVRILSLENGEEVLK 150 (340)
Q Consensus 122 ~~~~~~~~l~~-~~~~i~i~d~~~~~~~~~ 150 (340)
.+-.++..++. .++.+...|..+++..-.
T Consensus 149 ~v~~~~~v~~~s~~g~~~al~~~tG~~~W~ 178 (370)
T COG1520 149 PVVGDGTVYVGTDDGHLYALNADTGTLKWT 178 (370)
T ss_pred cEEcCcEEEEecCCCeEEEEEccCCcEEEE
Confidence 23334444444 345577777776765543
No 422
>PF07569 Hira: TUP1-like enhancer of split; InterPro: IPR011494 The Hira proteins are found in a range of eukaryotes and are implicated in the assembly of repressive chromatin. These proteins also contain IPR001680 from INTERPRO.; GO: 0006355 regulation of transcription, DNA-dependent, 0005634 nucleus
Probab=94.01 E-value=0.55 Score=37.85 Aligned_cols=29 Identities=14% Similarity=0.252 Sum_probs=24.2
Q ss_pred EecCCCEEEEEeCCCcEEEEeCCCCeEEE
Q 036605 81 FAKKGRSLHVVGTNGMASEMKSEMGEVIR 109 (340)
Q Consensus 81 ~~~~~~~l~s~~~dg~i~~wd~~~~~~~~ 109 (340)
+..++.+|++...+|.+++||+.+++.+.
T Consensus 18 l~~~~~~Ll~iT~~G~l~vWnl~~~k~~~ 46 (219)
T PF07569_consen 18 LECNGSYLLAITSSGLLYVWNLKKGKAVL 46 (219)
T ss_pred EEeCCCEEEEEeCCCeEEEEECCCCeecc
Confidence 34568899999999999999999887643
No 423
>PRK13684 Ycf48-like protein; Provisional
Probab=93.90 E-value=3.9 Score=35.44 Aligned_cols=152 Identities=12% Similarity=0.026 Sum_probs=78.1
Q ss_pred CCCeEEEEEecCCCEEEEEeCCCcEEEE-eCCCCeEEEEe-ecCCCCeeEEEEccCCCEEEEecCcEEEE-ECCCCceeE
Q 036605 73 PGGLAGLAFAKKGRSLHVVGTNGMASEM-KSEMGEVIREF-KASEKPISSSAFLCEEKIFALASSEVRIL-SLENGEEVL 149 (340)
Q Consensus 73 ~~~v~~v~~~~~~~~l~s~~~dg~i~~w-d~~~~~~~~~~-~~~~~~i~~l~~~~~~~~l~~~~~~i~i~-d~~~~~~~~ 149 (340)
.+.+.++.+.+++..+++ +..|.+..- + ..++.-... ......++++.+.++++.++++.+-..+. ....+..-.
T Consensus 172 ~g~~~~i~~~~~g~~v~~-g~~G~i~~s~~-~gg~tW~~~~~~~~~~l~~i~~~~~g~~~~vg~~G~~~~~s~d~G~sW~ 249 (334)
T PRK13684 172 AGVVRNLRRSPDGKYVAV-SSRGNFYSTWE-PGQTAWTPHQRNSSRRLQSMGFQPDGNLWMLARGGQIRFNDPDDLESWS 249 (334)
T ss_pred cceEEEEEECCCCeEEEE-eCCceEEEEcC-CCCCeEEEeeCCCcccceeeeEcCCCCEEEEecCCEEEEccCCCCCccc
Confidence 457889999988766554 555655432 2 222222222 23345788999999998877755444344 234443222
Q ss_pred Eeec----CCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEe
Q 036605 150 KFSD----DVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVA 225 (340)
Q Consensus 150 ~~~~----~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s 225 (340)
.... ....+..+.+.+++..+++ +. +|.+.. .. ..++.-.........+.....+ .+ ..+ ...+.++
T Consensus 250 ~~~~~~~~~~~~l~~v~~~~~~~~~~~-G~-~G~v~~-S~--d~G~tW~~~~~~~~~~~~~~~~--~~-~~~-~~~~~~G 320 (334)
T PRK13684 250 KPIIPEITNGYGYLDLAYRTPGEIWAG-GG-NGTLLV-SK--DGGKTWEKDPVGEEVPSNFYKI--VF-LDP-EKGFVLG 320 (334)
T ss_pred cccCCccccccceeeEEEcCCCCEEEE-cC-CCeEEE-eC--CCCCCCeECCcCCCCCcceEEE--EE-eCC-CceEEEC
Confidence 2211 1234678899988775555 55 666543 32 2222211111000111122222 22 222 3456677
Q ss_pred CCCcEEEEEC
Q 036605 226 ESGVAYSWDL 235 (340)
Q Consensus 226 ~dg~i~vwd~ 235 (340)
..|.|.-|+-
T Consensus 321 ~~G~il~~~~ 330 (334)
T PRK13684 321 QRGVLLRYVG 330 (334)
T ss_pred CCceEEEecC
Confidence 7888877764
No 424
>COG4257 Vgb Streptogramin lyase [Defense mechanisms]
Probab=93.77 E-value=3.3 Score=34.16 Aligned_cols=110 Identities=14% Similarity=0.093 Sum_probs=79.8
Q ss_pred CeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecC-cEEEEECCCCceeEEee-
Q 036605 75 GLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASS-EVRILSLENGEEVLKFS- 152 (340)
Q Consensus 75 ~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~-~i~i~d~~~~~~~~~~~- 152 (340)
.-..++-.|||..-+++...+.|--.|..+|+....--+.......|...|||..-++-.+ .|.-+|-++.+. .+|.
T Consensus 63 ap~dvapapdG~VWft~qg~gaiGhLdP~tGev~~ypLg~Ga~Phgiv~gpdg~~Witd~~~aI~R~dpkt~ev-t~f~l 141 (353)
T COG4257 63 APFDVAPAPDGAVWFTAQGTGAIGHLDPATGEVETYPLGSGASPHGIVVGPDGSAWITDTGLAIGRLDPKTLEV-TRFPL 141 (353)
T ss_pred CccccccCCCCceEEecCccccceecCCCCCceEEEecCCCCCCceEEECCCCCeeEecCcceeEEecCcccce-EEeec
Confidence 4567788899999999999999999999999977665455566788999999988877555 477777766643 3332
Q ss_pred ---cCCCCeEEEEECCCCCEEEEEEcC--------CCeEEEEEc
Q 036605 153 ---DDVGPLQYVSASDGAKIIITAGYG--------EKHLQVWRC 185 (340)
Q Consensus 153 ---~~~~~v~~~~~s~~~~~l~s~~~~--------d~~i~iwd~ 185 (340)
.-........|.+.|..-+++..+ .+.|++|+.
T Consensus 142 p~~~a~~nlet~vfD~~G~lWFt~q~G~yGrLdPa~~~i~vfpa 185 (353)
T COG4257 142 PLEHADANLETAVFDPWGNLWFTGQIGAYGRLDPARNVISVFPA 185 (353)
T ss_pred ccccCCCcccceeeCCCccEEEeeccccceecCcccCceeeecc
Confidence 123557788999999877775431 245666665
No 425
>PF07995 GSDH: Glucose / Sorbosone dehydrogenase; InterPro: IPR012938 Proteins containing this domain are thought to be glucose/sorbosone dehydrogenases. The best characterised of these proteins is soluble glucose dehydrogenase (P13650 from SWISSPROT) from Acinetobacter calcoaceticus, which oxidises glucose to gluconolactone. The enzyme is a calcium-dependent homodimer which uses PQQ as a cofactor [].; GO: 0016901 oxidoreductase activity, acting on the CH-OH group of donors, quinone or similar compound as acceptor, 0048038 quinone binding, 0005975 carbohydrate metabolic process; PDB: 2ISM_A 2WG3_D 3HO5_A 3HO4_A 3HO3_A 2WFT_A 2WG4_B 2WFX_B 1CRU_A 1CQ1_B ....
Probab=93.77 E-value=3 Score=36.10 Aligned_cols=99 Identities=23% Similarity=0.240 Sum_probs=56.6
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCee---EEEec---CCCCCCeEEEEEecC---CCEEEEEeC
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEM---KWKST---GRHPGGLAGLAFAKK---GRSLHVVGT 93 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~---~~~~~---~~h~~~v~~v~~~~~---~~~l~s~~~ 93 (340)
..+.|+|.|+++ + +++...|.|++++ ..+.. +..+. .........++++|+ ..+|+....
T Consensus 3 ~P~~~a~~pdG~---------l-~v~e~~G~i~~~~-~~g~~~~~v~~~~~v~~~~~~gllgia~~p~f~~n~~lYv~~t 71 (331)
T PF07995_consen 3 NPRSMAFLPDGR---------L-LVAERSGRIWVVD-KDGSLKTPVADLPEVFADGERGLLGIAFHPDFASNGYLYVYYT 71 (331)
T ss_dssp SEEEEEEETTSC---------E-EEEETTTEEEEEE-TTTEECEEEEE-TTTBTSTTBSEEEEEE-TTCCCC-EEEEEEE
T ss_pred CceEEEEeCCCc---------E-EEEeCCceEEEEe-CCCcCcceecccccccccccCCcccceeccccCCCCEEEEEEE
Confidence 357899999999 5 5556799999999 45543 22221 124557899999994 345554433
Q ss_pred C---------CcEEEEeCCCC-------eEEE-Eeec---CCCCeeEEEEccCCCEEEE
Q 036605 94 N---------GMASEMKSEMG-------EVIR-EFKA---SEKPISSSAFLCEEKIFAL 132 (340)
Q Consensus 94 d---------g~i~~wd~~~~-------~~~~-~~~~---~~~~i~~l~~~~~~~~l~~ 132 (340)
. ..|.-|....+ +.+. .+.. .......|.|.|||.+.++
T Consensus 72 ~~~~~~~~~~~~v~r~~~~~~~~~~~~~~~l~~~~p~~~~~~H~g~~l~fgpDG~LYvs 130 (331)
T PF07995_consen 72 NADEDGGDNDNRVVRFTLSDGDGDLSSEEVLVTGLPDTSSGNHNGGGLAFGPDGKLYVS 130 (331)
T ss_dssp EE-TSSSSEEEEEEEEEEETTSCEEEEEEEEEEEEES-CSSSS-EEEEEE-TTSEEEEE
T ss_pred cccCCCCCcceeeEEEeccCCccccccceEEEEEeCCCCCCCCCCccccCCCCCcEEEE
Confidence 1 24555544433 1111 1222 2334567999999976665
No 426
>KOG1900 consensus Nuclear pore complex, Nup155 component (D Nup154, sc Nup157/Nup170) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=93.70 E-value=4 Score=40.96 Aligned_cols=137 Identities=12% Similarity=0.181 Sum_probs=83.1
Q ss_pred EEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEE--------ecCCCEEEEEeCCCcEEEEeCCC----CeE---E--E
Q 036605 47 LGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAF--------AKKGRSLHVVGTNGMASEMKSEM----GEV---I--R 109 (340)
Q Consensus 47 ~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~--------~~~~~~l~s~~~dg~i~~wd~~~----~~~---~--~ 109 (340)
--+.|..+.+|+.+++.....+.+ -...|..|.. .|.=++|+..+.--.|.++-+.- +.. . .
T Consensus 94 WiTiDn~L~lWny~~~~e~~~~d~-~shtIl~V~LvkPkpgvFv~~IqhlLvvaT~~ei~ilgV~~~~~~~~~~~f~~~~ 172 (1311)
T KOG1900|consen 94 WITIDNNLFLWNYESDNELAEYDG-LSHTILKVGLVKPKPGVFVPEIQHLLVVATPVEIVILGVSFDEFTGELSIFNTSF 172 (1311)
T ss_pred EEEeCCeEEEEEcCCCCccccccc-hhhhheeeeeecCCCCcchhhhheeEEecccceEEEEEEEeccccCcccccccce
Confidence 345688999999999776666666 5555666543 23334444444444555553321 111 0 1
Q ss_pred EeecCCCCeeEEEEccCCCEEEEecCcEEEEEC----CCC---c-----------------eeEEee-cCCCCeEEEEEC
Q 036605 110 EFKASEKPISSSAFLCEEKIFALASSEVRILSL----ENG---E-----------------EVLKFS-DDVGPLQYVSAS 164 (340)
Q Consensus 110 ~~~~~~~~i~~l~~~~~~~~l~~~~~~i~i~d~----~~~---~-----------------~~~~~~-~~~~~v~~~~~s 164 (340)
.+......|.++....+|+++++|... .+|.+ ..+ + .+..+. .+..+|..+...
T Consensus 173 ~i~~dg~~V~~I~~t~nGRIF~~G~dg-~lyEl~Yq~~~gWf~~rc~Kiclt~s~ls~lvPs~~~~~~~~~dpI~qi~ID 251 (1311)
T KOG1900|consen 173 KISVDGVSVNCITYTENGRIFFAGRDG-NLYELVYQAEDGWFGSRCRKICLTKSVLSSLVPSLLSVPGSSKDPIRQITID 251 (1311)
T ss_pred eeecCCceEEEEEeccCCcEEEeecCC-CEEEEEEeccCchhhcccccccCchhHHHHhhhhhhcCCCCCCCcceeeEec
Confidence 122234567888888899998885443 33332 221 0 011223 456789999998
Q ss_pred CCCCEEEEEEcCCCeEEEEEcc
Q 036605 165 DGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 165 ~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
..-..+++-+. .+.|.+|++.
T Consensus 252 ~SR~IlY~lse-k~~v~~Y~i~ 272 (1311)
T KOG1900|consen 252 NSRNILYVLSE-KGTVSAYDIG 272 (1311)
T ss_pred cccceeeeecc-CceEEEEEcc
Confidence 88777888666 8999999994
No 427
>PF10168 Nup88: Nuclear pore component; InterPro: IPR019321 Nup88 can be divided into two structural domains; the N-terminal two-thirds of the protein have no obvious structural motifs. It is, however, where it binds to Nup98; one of the components of the nuclear pore. The C-terminal end is a predicted coiled-coil domain []. Nup88 is over expressed in tumour cells [].
Probab=93.70 E-value=6.6 Score=37.82 Aligned_cols=79 Identities=14% Similarity=0.146 Sum_probs=54.2
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEcc---------CCe--eEEEe--------cCCCCCCeEEE
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVL---------TGE--MKWKS--------TGRHPGGLAGL 79 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~---------~~~--~~~~~--------~~~h~~~v~~v 79 (340)
...-.|..+..+|+|+ +||..+..|.+.+.=.. .|+ ..++. ...+...|..+
T Consensus 82 ~~~f~v~~i~~n~~g~---------~lal~G~~~v~V~~LP~r~g~~~~~~~g~~~i~Crt~~v~~~~~~~~~~~~i~qv 152 (717)
T PF10168_consen 82 PPLFEVHQISLNPTGS---------LLALVGPRGVVVLELPRRWGKNGEFEDGKKEINCRTVPVDERFFTSNSSLEIKQV 152 (717)
T ss_pred CCceeEEEEEECCCCC---------EEEEEcCCcEEEEEeccccCccccccCCCcceeEEEEEechhhccCCCCceEEEE
Confidence 3446788999999999 88888887654442211 121 12221 11245688999
Q ss_pred EEecC---CCEEEEEeCCCcEEEEeCCCCe
Q 036605 80 AFAKK---GRSLHVVGTNGMASEMKSEMGE 106 (340)
Q Consensus 80 ~~~~~---~~~l~s~~~dg~i~~wd~~~~~ 106 (340)
.|+|. +..|+.-..|+.+++||+....
T Consensus 153 ~WhP~s~~~~~l~vLtsdn~lR~y~~~~~~ 182 (717)
T PF10168_consen 153 RWHPWSESDSHLVVLTSDNTLRLYDISDPQ 182 (717)
T ss_pred EEcCCCCCCCeEEEEecCCEEEEEecCCCC
Confidence 99996 4788888999999999997543
No 428
>KOG1916 consensus Nuclear protein, contains WD40 repeats [General function prediction only]
Probab=93.68 E-value=0.082 Score=50.02 Aligned_cols=83 Identities=12% Similarity=0.172 Sum_probs=54.3
Q ss_pred CCeEEEEeecc---ccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEE-----------EecCCCE
Q 036605 22 VSYSCLACGFV---GKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLA-----------FAKKGRS 87 (340)
Q Consensus 22 ~~v~~l~~sp~---~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~-----------~~~~~~~ 87 (340)
..+.-+.|.|- .- ++..+..+++|++.+..+... ..+.+ |...+..++ .+|||..
T Consensus 181 s~~~~V~wcp~~~~~~---------~ic~~~~~~~i~lL~~~ra~~-~l~rs-Hs~~~~d~a~~~~g~~~l~~lSpDGtv 249 (1283)
T KOG1916|consen 181 SDPQLVSWCPIAVNKV---------YICYGLKGGEIRLLNINRALR-SLFRS-HSQRVTDMAFFAEGVLKLASLSPDGTV 249 (1283)
T ss_pred CCcceeeecccccccc---------eeeeccCCCceeEeeechHHH-HHHHh-cCCCcccHHHHhhchhhheeeCCCCcE
Confidence 34456667654 34 788888999999877655432 23333 655554443 5899999
Q ss_pred EEEEeCCCcEEEEeCC-CC----eEEEEeecCC
Q 036605 88 LHVVGTNGMASEMKSE-MG----EVIREFKASE 115 (340)
Q Consensus 88 l~s~~~dg~i~~wd~~-~~----~~~~~~~~~~ 115 (340)
++.+..||.+..|.+. +| ..++.++.|.
T Consensus 250 ~a~a~~dG~v~f~Qiyi~g~~~~rclhewkphd 282 (1283)
T KOG1916|consen 250 FAWAISDGSVGFYQIYITGKIVHRCLHEWKPHD 282 (1283)
T ss_pred EEEeecCCccceeeeeeeccccHhhhhccCCCC
Confidence 9999999998888653 12 2345566665
No 429
>PF14655 RAB3GAP2_N: Rab3 GTPase-activating protein regulatory subunit N-terminus
Probab=93.64 E-value=1.3 Score=39.25 Aligned_cols=81 Identities=17% Similarity=0.238 Sum_probs=54.4
Q ss_pred CCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeE-EEEccC-----------------CCEEEE-
Q 036605 72 HPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISS-SAFLCE-----------------EKIFAL- 132 (340)
Q Consensus 72 h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~-l~~~~~-----------------~~~l~~- 132 (340)
....+.+++.+|++++.++.+.-|.|.++|+.++..++.|++-.+.-.. +..... ..+|+.
T Consensus 306 ~~R~~~~i~~sP~~~laA~tDslGRV~LiD~~~~~vvrmWKGYRdAqc~wi~~~~~~~~~~~~~~~~~~~~~~~l~LvIy 385 (415)
T PF14655_consen 306 SKREGESICLSPSGRLAAVTDSLGRVLLIDVARGIVVRMWKGYRDAQCGWIEVPEEGDRDRSNSNSPKSSSRFALFLVIY 385 (415)
T ss_pred CCceEEEEEECCCCCEEEEEcCCCcEEEEECCCChhhhhhccCccceEEEEEeecccccccccccccCCCCcceEEEEEE
Confidence 3346788999999888887766699999999999988888876543221 111111 112322
Q ss_pred ecCc--EEEEECCCCceeEEee
Q 036605 133 ASSE--VRILSLENGEEVLKFS 152 (340)
Q Consensus 133 ~~~~--i~i~d~~~~~~~~~~~ 152 (340)
+-+. |-||.++.|..+..+.
T Consensus 386 aprRg~lEvW~~~~g~Rv~a~~ 407 (415)
T PF14655_consen 386 APRRGILEVWSMRQGPRVAAFN 407 (415)
T ss_pred eccCCeEEEEecCCCCEEEEEE
Confidence 3333 8899999888776664
No 430
>PF10168 Nup88: Nuclear pore component; InterPro: IPR019321 Nup88 can be divided into two structural domains; the N-terminal two-thirds of the protein have no obvious structural motifs. It is, however, where it binds to Nup98; one of the components of the nuclear pore. The C-terminal end is a predicted coiled-coil domain []. Nup88 is over expressed in tumour cells [].
Probab=93.54 E-value=3.1 Score=39.92 Aligned_cols=25 Identities=20% Similarity=0.381 Sum_probs=19.8
Q ss_pred CeEEEEEecCCCEEEEEeCCCcEEE
Q 036605 75 GLAGLAFAKKGRSLHVVGTNGMASE 99 (340)
Q Consensus 75 ~v~~v~~~~~~~~l~s~~~dg~i~~ 99 (340)
.|..|.++|+|..|+..|..|.+.+
T Consensus 86 ~v~~i~~n~~g~~lal~G~~~v~V~ 110 (717)
T PF10168_consen 86 EVHQISLNPTGSLLALVGPRGVVVL 110 (717)
T ss_pred eEEEEEECCCCCEEEEEcCCcEEEE
Confidence 5788889999999998888765444
No 431
>PF07676 PD40: WD40-like Beta Propeller Repeat; InterPro: IPR011659 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events. This region appears to be related to the IPR001680 from INTERPRO repeat. This model is likely to miss copies within a sequence.; PDB: 2HQS_D 1C5K_A 2IVZ_A 2W8B_D 3IAX_A 1CRZ_A 1N6F_D 1N6D_C 1N6E_C 1K32_A ....
Probab=93.48 E-value=0.46 Score=26.10 Aligned_cols=33 Identities=12% Similarity=0.134 Sum_probs=23.4
Q ss_pred eecCCCCeEEEEECCCCCEEEEEEcCC--CeEEEE
Q 036605 151 FSDDVGPLQYVSASDGAKIIITAGYGE--KHLQVW 183 (340)
Q Consensus 151 ~~~~~~~v~~~~~s~~~~~l~s~~~~d--~~i~iw 183 (340)
+...........|+|||++|+.++..+ |...||
T Consensus 4 ~t~~~~~~~~p~~SpDGk~i~f~s~~~~~g~~diy 38 (39)
T PF07676_consen 4 LTNSPGDDGSPAWSPDGKYIYFTSNRNDRGSFDIY 38 (39)
T ss_dssp ES-SSSSEEEEEE-TTSSEEEEEEECT--SSEEEE
T ss_pred cccCCccccCEEEecCCCEEEEEecCCCCCCcCEE
Confidence 334456678889999999999888766 666666
No 432
>PF07569 Hira: TUP1-like enhancer of split; InterPro: IPR011494 The Hira proteins are found in a range of eukaryotes and are implicated in the assembly of repressive chromatin. These proteins also contain IPR001680 from INTERPRO.; GO: 0006355 regulation of transcription, DNA-dependent, 0005634 nucleus
Probab=93.45 E-value=0.89 Score=36.63 Aligned_cols=59 Identities=14% Similarity=0.208 Sum_probs=39.8
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEe-------cC------CCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCC
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKS-------TG------RHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSE 103 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~-------~~------~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~ 103 (340)
+|++-+.+|.+++||+.+++.+..- .. .....|..+.++.+|.-+++-+ +|..+.|+..
T Consensus 24 ~Ll~iT~~G~l~vWnl~~~k~~~~~~Si~pll~~~~~~~~~~~~~i~~~~lt~~G~PiV~ls-ng~~y~y~~~ 95 (219)
T PF07569_consen 24 YLLAITSSGLLYVWNLKKGKAVLPPVSIAPLLNSSPVSDKSSSPNITSCSLTSNGVPIVTLS-NGDSYSYSPD 95 (219)
T ss_pred EEEEEeCCCeEEEEECCCCeeccCCccHHHHhcccccccCCCCCcEEEEEEcCCCCEEEEEe-CCCEEEeccc
Confidence 8999999999999999998754322 10 1334566677776666665544 3566677654
No 433
>COG4257 Vgb Streptogramin lyase [Defense mechanisms]
Probab=93.02 E-value=4.5 Score=33.44 Aligned_cols=187 Identities=11% Similarity=0.075 Sum_probs=113.1
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeC
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKS 102 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~ 102 (340)
.-..++-.|||. .-+++...|.|--.|..+|+...--.+ ....-..|..-|||..-++-+.. .|.-+|.
T Consensus 63 ap~dvapapdG~---------VWft~qg~gaiGhLdP~tGev~~ypLg-~Ga~Phgiv~gpdg~~Witd~~~-aI~R~dp 131 (353)
T COG4257 63 APFDVAPAPDGA---------VWFTAQGTGAIGHLDPATGEVETYPLG-SGASPHGIVVGPDGSAWITDTGL-AIGRLDP 131 (353)
T ss_pred CccccccCCCCc---------eEEecCccccceecCCCCCceEEEecC-CCCCCceEEECCCCCeeEecCcc-eeEEecC
Confidence 345567778887 777888888888888888875543333 44455677788888876653333 6777777
Q ss_pred CCCeEEEE---eecCCCCeeEEEEccCCCEEEEecCc-----------EEEEECCCCceeEEeecCCCCeEEEEECCCCC
Q 036605 103 EMGEVIRE---FKASEKPISSSAFLCEEKIFALASSE-----------VRILSLENGEEVLKFSDDVGPLQYVSASDGAK 168 (340)
Q Consensus 103 ~~~~~~~~---~~~~~~~i~~l~~~~~~~~l~~~~~~-----------i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~ 168 (340)
++.+...- .+..........|.+.|++-+++..- |++|+.-.| .....|+..|+|.
T Consensus 132 kt~evt~f~lp~~~a~~nlet~vfD~~G~lWFt~q~G~yGrLdPa~~~i~vfpaPqG----------~gpyGi~atpdGs 201 (353)
T COG4257 132 KTLEVTRFPLPLEHADANLETAVFDPWGNLWFTGQIGAYGRLDPARNVISVFPAPQG----------GGPYGICATPDGS 201 (353)
T ss_pred cccceEEeecccccCCCcccceeeCCCccEEEeeccccceecCcccCceeeeccCCC----------CCCcceEECCCCc
Confidence 66654321 12234456788899999988874422 455544322 3456788899998
Q ss_pred EEEEEEcCCCeEEEEEccCCCCCccCCceeeecCCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 169 IIITAGYGEKHLQVWRCDISSKTVNKGPALSMRHSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 169 ~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
.-++.-. ++.|...|- ..+ ....+. ............|.++-+..-++-...+.++-||-.+
T Consensus 202 vwyasla-gnaiaridp--~~~-~aev~p---~P~~~~~gsRriwsdpig~~wittwg~g~l~rfdPs~ 263 (353)
T COG4257 202 VWYASLA-GNAIARIDP--FAG-HAEVVP---QPNALKAGSRRIWSDPIGRAWITTWGTGSLHRFDPSV 263 (353)
T ss_pred EEEEecc-ccceEEccc--ccC-Ccceec---CCCcccccccccccCccCcEEEeccCCceeeEeCccc
Confidence 7777555 667766664 222 111111 1111122233344466777777766777777777655
No 434
>COG5167 VID27 Protein involved in vacuole import and degradation [Intracellular trafficking and secretion]
Probab=92.91 E-value=1.4 Score=39.42 Aligned_cols=131 Identities=9% Similarity=0.030 Sum_probs=78.1
Q ss_pred cCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccC-CeeEEEecCCCCCCeEEEEE
Q 036605 3 STNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLT-GEMKWKSTGRHPGGLAGLAF 81 (340)
Q Consensus 3 d~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~-~~~~~~~~~~h~~~v~~v~~ 81 (340)
|.+.|+++.+|. -|.. | -+.|.|..+-.+. ....-++|-++..|.-.|.+- |..+.... ....++--.|
T Consensus 496 DIErGkvveeW~----~~dd-v-vVqy~p~~kf~qm--t~eqtlvGlS~~svFrIDPR~~gNKi~v~e--sKdY~tKn~F 565 (776)
T COG5167 496 DIERGKVVEEWD----LKDD-V-VVQYNPYFKFQQM--TDEQTLVGLSDYSVFRIDPRARGNKIKVVE--SKDYKTKNKF 565 (776)
T ss_pred ecccceeeeEee----cCCc-c-eeecCCchhHHhc--CccceEEeecccceEEecccccCCceeeee--ehhccccccc
Confidence 677888888888 3333 3 5778776430000 001234455565666556543 32221111 1122222223
Q ss_pred e----cCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEE-ecCcEEEEECC
Q 036605 82 A----KKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFAL-ASSEVRILSLE 143 (340)
Q Consensus 82 ~----~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~-~~~~i~i~d~~ 143 (340)
+ ....+++.++..|.|++||--.-+...-+.+-...|-.+.++.+|+++++ +-..+.+.|+.
T Consensus 566 ss~~tTesGyIa~as~kGDirLyDRig~rAKtalP~lG~aIk~idvta~Gk~ilaTCk~yllL~d~~ 632 (776)
T COG5167 566 SSGMTTESGYIAAASRKGDIRLYDRIGKRAKTALPGLGDAIKHIDVTANGKHILATCKNYLLLTDVP 632 (776)
T ss_pred cccccccCceEEEecCCCceeeehhhcchhhhcCcccccceeeeEeecCCcEEEEeecceEEEEecc
Confidence 2 24558999999999999996544444446666778899999999998855 65568888864
No 435
>PF05935 Arylsulfotrans: Arylsulfotransferase (ASST); InterPro: IPR010262 This family consists of several bacterial arylsulphotransferase proteins. Arylsulphotransferase (ASST) transfers a sulphate group from phenolic sulphate esters to a phenolic acceptor substrate [].; PDB: 3ETT_B 3ELQ_A 3ETS_A.
Probab=92.79 E-value=7.7 Score=35.55 Aligned_cols=182 Identities=16% Similarity=0.166 Sum_probs=83.9
Q ss_pred CCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCC---eeEEEEccC
Q 036605 50 SNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKP---ISSSAFLCE 126 (340)
Q Consensus 50 ~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~---i~~l~~~~~ 126 (340)
..+.+.++|. .|...+.+.. .......+...++|.+++..+ ..+..+|+. |+.+..+...... -+.+...|+
T Consensus 126 ~~~~~~~iD~-~G~Vrw~~~~-~~~~~~~~~~l~nG~ll~~~~--~~~~e~D~~-G~v~~~~~l~~~~~~~HHD~~~l~n 200 (477)
T PF05935_consen 126 SSSYTYLIDN-NGDVRWYLPL-DSGSDNSFKQLPNGNLLIGSG--NRLYEIDLL-GKVIWEYDLPGGYYDFHHDIDELPN 200 (477)
T ss_dssp BEEEEEEEET-TS-EEEEE-G-GGT--SSEEE-TTS-EEEEEB--TEEEEE-TT---EEEEEE--TTEE-B-S-EEE-TT
T ss_pred CCceEEEECC-CccEEEEEcc-CccccceeeEcCCCCEEEecC--CceEEEcCC-CCEEEeeecCCcccccccccEECCC
Confidence 4567778884 4666666643 111111156677888776554 788899985 6766665543322 467788899
Q ss_pred CCEEEEec--------------Cc-EEEEECCCCceeEEee--cCC-------------------------CCeEEEEEC
Q 036605 127 EKIFALAS--------------SE-VRILSLENGEEVLKFS--DDV-------------------------GPLQYVSAS 164 (340)
Q Consensus 127 ~~~l~~~~--------------~~-i~i~d~~~~~~~~~~~--~~~-------------------------~~v~~~~~s 164 (340)
|++|+.+. .+ |..+| .+|+.+..+. .|- ..+.++.+.
T Consensus 201 Gn~L~l~~~~~~~~~~~~~~~~~D~Ivevd-~tG~vv~~wd~~d~ld~~~~~~~~~~~~~~~~~~~~~~DW~H~Nsi~yd 279 (477)
T PF05935_consen 201 GNLLILASETKYVDEDKDVDTVEDVIVEVD-PTGEVVWEWDFFDHLDPYRDTVLKPYPYGDISGSGGGRDWLHINSIDYD 279 (477)
T ss_dssp S-EEEEEEETTEE-TS-EE---S-EEEEE--TTS-EEEEEEGGGTS-TT--TTGGT--SSSSS-SSTTSBS--EEEEEEE
T ss_pred CCEEEEEeecccccCCCCccEecCEEEEEC-CCCCEEEEEehHHhCCcccccccccccccccccCCCCCCccccCccEEe
Confidence 99887644 11 66666 6666554431 110 236888998
Q ss_pred CCCCEEEEEEcCCCeEEEEEccCCCCCccCCce-------------eee-cCCCeeeee-ecCCCCCCCCEEEEEeCCC-
Q 036605 165 DGAKIIITAGYGEKHLQVWRCDISSKTVNKGPA-------------LSM-RHSPVAIDC-KNSPNGEDGTVILAVAESG- 228 (340)
Q Consensus 165 ~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~-------------~~~-~~~~~~~~~-~~~~~~~~~~~l~~~s~dg- 228 (340)
+....|+.++..-..|...|. .+++..-.+. +.. ........+ ...+.-.-|++-+.-..+|
T Consensus 280 ~~dd~iivSsR~~s~V~~Id~--~t~~i~Wilg~~~~w~~~~~~~ll~~vd~~G~~~~~~~~~~~~~~gQH~~~~~~~g~ 357 (477)
T PF05935_consen 280 PSDDSIIVSSRHQSAVIKIDY--RTGKIKWILGPPGGWNGTYQDYLLTPVDSNGNPIDCGDGDFDWFWGQHTAHLIPDGP 357 (477)
T ss_dssp TTTTEEEEEETTT-EEEEEE---TTS-EEEEES-STT--TTTGGGB-EEB-TTS-B-EBSSSS----SS-EEEEE-TTS-
T ss_pred CCCCeEEEEcCcceEEEEEEC--CCCcEEEEeCCCCCCCcccchheeeeeccCCceeeccCCCCcccccccceEEcCCCC
Confidence 854555555664556666664 3332211111 000 000000000 0111124466777777888
Q ss_pred --cEEEEECCCCC
Q 036605 229 --VAYSWDLKTVS 239 (340)
Q Consensus 229 --~i~vwd~~~~~ 239 (340)
.|.+||=....
T Consensus 358 ~~~l~vFDNg~~r 370 (477)
T PF05935_consen 358 QGNLLVFDNGNGR 370 (477)
T ss_dssp --SEEEEE--TTG
T ss_pred eEEEEEEECCCCC
Confidence 99999876644
No 436
>PF14761 HPS3_N: Hermansky-Pudlak syndrome 3
Probab=92.50 E-value=4.5 Score=32.14 Aligned_cols=45 Identities=22% Similarity=0.296 Sum_probs=32.7
Q ss_pred EEEecCcEEEEECCC--CceeEEeecCCCCeEEEEECCCCCEEEEEEc
Q 036605 130 FALASSEVRILSLEN--GEEVLKFSDDVGPLQYVSASDGAKIIITAGY 175 (340)
Q Consensus 130 l~~~~~~i~i~d~~~--~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~ 175 (340)
+++++..|.+|++.. .+.+..|.. -+.|..+.++..|.|+++-=.
T Consensus 33 va~~g~~Vev~~l~~~~~~~~~~F~T-v~~V~~l~y~~~GDYlvTlE~ 79 (215)
T PF14761_consen 33 VAASGCKVEVYDLEQEECPLLCTFST-VGRVLQLVYSEAGDYLVTLEE 79 (215)
T ss_pred EEcCCCEEEEEEcccCCCceeEEEcc-hhheeEEEeccccceEEEEEe
Confidence 345666699999883 344466653 378899999999999998543
No 437
>PF05096 Glu_cyclase_2: Glutamine cyclotransferase; InterPro: IPR007788 This family of enzymes 2.3.2.5 from EC catalyse the cyclization of free L-glutamine and N-terminal glutaminyl residues in proteins to pyroglutamate (5-oxoproline) and pyroglutamyl residues respectively []. This family includes plant and bacterial enzymes and seems unrelated to the mammalian enzymes.; PDB: 3NOK_B 2FAW_A 2IWA_A 3NOM_A 3NOL_A 3MBR_X.
Probab=92.36 E-value=5.5 Score=32.88 Aligned_cols=151 Identities=14% Similarity=0.037 Sum_probs=84.4
Q ss_pred CCCCCe-EEEEeeccccccccccCceEEEEEcCCC--cEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEE-eCC
Q 036605 19 EPVVSY-SCLACGFVGKKRRKERGTLLLALGTSNG--DILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVV-GTN 94 (340)
Q Consensus 19 ~~~~~v-~~l~~sp~~~~~~~~~~~~~l~~g~~dg--~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~-~~d 94 (340)
|..... -.+.|..++. ++-+.+.-| .|+.+|+.+|+......-...-.--.++.. +..|+-- =.+
T Consensus 41 Hd~~aFTQGL~~~~~g~---------LyESTG~yG~S~l~~~d~~tg~~~~~~~l~~~~FgEGit~~--~d~l~qLTWk~ 109 (264)
T PF05096_consen 41 HDPTAFTQGLEFLDDGT---------LYESTGLYGQSSLRKVDLETGKVLQSVPLPPRYFGEGITIL--GDKLYQLTWKE 109 (264)
T ss_dssp --TT-EEEEEEEEETTE---------EEEEECSTTEEEEEEEETTTSSEEEEEE-TTT--EEEEEEE--TTEEEEEESSS
T ss_pred CCCcccCccEEecCCCE---------EEEeCCCCCcEEEEEEECCCCcEEEEEECCccccceeEEEE--CCEEEEEEecC
Confidence 333343 3466767777 666666555 799999999987655442122222344544 3344443 467
Q ss_pred CcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCCceeEEeecC--C---CCeEEEEECCCC
Q 036605 95 GMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENGEEVLKFSDD--V---GPLQYVSASDGA 167 (340)
Q Consensus 95 g~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~~~~~~~--~---~~v~~~~~s~~~ 167 (340)
+...+||..+.+.+.++.-. ..-..++ .++..|+..+++ ++++|..+.+....+.-. . ..++.+.|- +|
T Consensus 110 ~~~f~yd~~tl~~~~~~~y~-~EGWGLt--~dg~~Li~SDGS~~L~~~dP~~f~~~~~i~V~~~g~pv~~LNELE~i-~G 185 (264)
T PF05096_consen 110 GTGFVYDPNTLKKIGTFPYP-GEGWGLT--SDGKRLIMSDGSSRLYFLDPETFKEVRTIQVTDNGRPVSNLNELEYI-NG 185 (264)
T ss_dssp SEEEEEETTTTEEEEEEE-S-SS--EEE--ECSSCEEEE-SSSEEEEE-TTT-SEEEEEE-EETTEE---EEEEEEE-TT
T ss_pred CeEEEEccccceEEEEEecC-CcceEEE--cCCCEEEEECCccceEEECCcccceEEEEEEEECCEECCCcEeEEEE-cC
Confidence 89999999999988887643 3446666 556666665554 999999887766655321 1 345556664 33
Q ss_pred CEEEEEEcCCCeEEEEEc
Q 036605 168 KIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 168 ~~l~s~~~~d~~i~iwd~ 185 (340)
+|.+--.....|...|.
T Consensus 186 -~IyANVW~td~I~~Idp 202 (264)
T PF05096_consen 186 -KIYANVWQTDRIVRIDP 202 (264)
T ss_dssp -EEEEEETTSSEEEEEET
T ss_pred -EEEEEeCCCCeEEEEeC
Confidence 44443333445555454
No 438
>PF10647 Gmad1: Lipoprotein LpqB beta-propeller domain; InterPro: IPR018910 The Gmad1 domain is found associated with IPR019606 from INTERPRO, in bacterial spore formation. It is predicted to have a beta-propeller fold and to have a passive binding role rather than a catalytic function owing to the low number of conserved hydrophilic residues.
Probab=92.33 E-value=5.6 Score=32.89 Aligned_cols=108 Identities=10% Similarity=0.119 Sum_probs=67.0
Q ss_pred CeEEEEEecCCCEEEEEe--C-CCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEE-ECCCCcee
Q 036605 75 GLAGLAFAKKGRSLHVVG--T-NGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRIL-SLENGEEV 148 (340)
Q Consensus 75 ~v~~v~~~~~~~~l~s~~--~-dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~-d~~~~~~~ 148 (340)
.+...+++++++.++... . ...+.++... .....+. ....+....|++++...+..++. .+++ +...+...
T Consensus 25 ~~~s~AvS~dg~~~A~v~~~~~~~~L~~~~~~--~~~~~~~-~g~~l~~PS~d~~g~~W~v~~~~~~~~~~~~~~~g~~~ 101 (253)
T PF10647_consen 25 DVTSPAVSPDGSRVAAVSEGDGGRSLYVGPAG--GPVRPVL-TGGSLTRPSWDPDGWVWTVDDGSGGVRVVRDSASGTGE 101 (253)
T ss_pred cccceEECCCCCeEEEEEEcCCCCEEEEEcCC--Ccceeec-cCCccccccccCCCCEEEEEcCCCceEEEEecCCCcce
Confidence 688999999999877765 2 2445555443 3222322 22367888899998877765444 4444 33333222
Q ss_pred -EEeecC--CCCeEEEEECCCCCEEEEEEc--CCCeEEEEEc
Q 036605 149 -LKFSDD--VGPLQYVSASDGAKIIITAGY--GEKHLQVWRC 185 (340)
Q Consensus 149 -~~~~~~--~~~v~~~~~s~~~~~l~s~~~--~d~~i~iwd~ 185 (340)
..+... ...|..+.+||||..++.... .++.|.|--+
T Consensus 102 ~~~v~~~~~~~~I~~l~vSpDG~RvA~v~~~~~~~~v~va~V 143 (253)
T PF10647_consen 102 PVEVDWPGLRGRITALRVSPDGTRVAVVVEDGGGGRVYVAGV 143 (253)
T ss_pred eEEecccccCCceEEEEECCCCcEEEEEEecCCCCeEEEEEE
Confidence 222211 128999999999998877663 2567777665
No 439
>PF12657 TFIIIC_delta: Transcription factor IIIC subunit delta N-term; InterPro: IPR024761 This entry represents a domain found towards the N terminus of the 90 kDa subunit of transcription factor IIIC (also known as subunit 9 in yeast []). The whole subunit is involved in RNA polymerase III-mediated transcription. It is possible that this N-terminal domain interacts with TFIIIC subunit 8 [].
Probab=92.22 E-value=1.1 Score=34.67 Aligned_cols=30 Identities=23% Similarity=0.222 Sum_probs=23.6
Q ss_pred CeEEEEEecCC------CEEEEEeCCCcEEEEeCCC
Q 036605 75 GLAGLAFAKKG------RSLHVVGTNGMASEMKSEM 104 (340)
Q Consensus 75 ~v~~v~~~~~~------~~l~s~~~dg~i~~wd~~~ 104 (340)
.|..++|||.| ..|++...++.|.+|....
T Consensus 87 ~vv~~aWSP~Gl~~~~rClLavLTs~~~l~l~~~~~ 122 (173)
T PF12657_consen 87 QVVSAAWSPSGLGPNGRCLLAVLTSNGRLSLYGPPG 122 (173)
T ss_pred cEEEEEECCCCCCCCCceEEEEEcCCCeEEEEecCC
Confidence 68889999854 3678888899999997664
No 440
>PF12768 Rax2: Cortical protein marker for cell polarity
Probab=91.69 E-value=3.7 Score=34.43 Aligned_cols=89 Identities=17% Similarity=0.278 Sum_probs=52.8
Q ss_pred ccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEc------CCCcEEEEEccCCeeEEEecC----C
Q 036605 2 WSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGT------SNGDILAVDVLTGEMKWKSTG----R 71 (340)
Q Consensus 2 wd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~------~dg~i~i~d~~~~~~~~~~~~----~ 71 (340)
||+.+.+... ...+..+.|+.|.|..+.+ +++.|. ....+..||..+.... .+.. .
T Consensus 21 yd~~~~qW~~----~g~~i~G~V~~l~~~~~~~---------Llv~G~ft~~~~~~~~la~yd~~~~~w~-~~~~~~s~~ 86 (281)
T PF12768_consen 21 YDTDNSQWSS----PGNGISGTVTDLQWASNNQ---------LLVGGNFTLNGTNSSNLATYDFKNQTWS-SLGGGSSNS 86 (281)
T ss_pred EECCCCEeec----CCCCceEEEEEEEEecCCE---------EEEEEeeEECCCCceeEEEEecCCCeee-ecCCccccc
Confidence 5555554332 2235778999999986667 777764 4567888998877532 3332 1
Q ss_pred CCCCeEEEEEec-CCCEEEEEe--C--CCcEEEEeCCC
Q 036605 72 HPGGLAGLAFAK-KGRSLHVVG--T--NGMASEMKSEM 104 (340)
Q Consensus 72 h~~~v~~v~~~~-~~~~l~s~~--~--dg~i~~wd~~~ 104 (340)
-+++|..+.+.. |+..++.++ . +..|..||-..
T Consensus 87 ipgpv~a~~~~~~d~~~~~~aG~~~~g~~~l~~~dGs~ 124 (281)
T PF12768_consen 87 IPGPVTALTFISNDGSNFWVAGRSANGSTFLMKYDGSS 124 (281)
T ss_pred CCCcEEEEEeeccCCceEEEeceecCCCceEEEEcCCc
Confidence 247888887743 444444332 2 23456665433
No 441
>PF03088 Str_synth: Strictosidine synthase; InterPro: IPR018119 This entry represents a conserved region found in strictosidine synthase (4.3.3.2 from EC), a key enzyme in alkaloid biosynthesis. It catalyses the Pictet-Spengler stereospecific condensation of tryptamine with secologanin to form strictosidine []. The structure of the native enzyme from the Indian medicinal plant Rauvolfia serpentina (Serpentwood) (Devilpepper) represents the first example of a six-bladed four-stranded beta-propeller fold from the plant kingdom [].; GO: 0016844 strictosidine synthase activity, 0009058 biosynthetic process; PDB: 2FPB_A 2V91_B 2FP8_A 3V1S_B 2FPC_A 2VAQ_A 2FP9_B.
Probab=91.69 E-value=1.7 Score=29.29 Aligned_cols=42 Identities=12% Similarity=-0.018 Sum_probs=28.5
Q ss_pred EeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEe
Q 036605 91 VGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALA 133 (340)
Q Consensus 91 ~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~ 133 (340)
+..+|.+..||+.+++....+.+ -.-.+.|++++|+.+++.+
T Consensus 33 ~~~~GRll~ydp~t~~~~vl~~~-L~fpNGVals~d~~~vlv~ 74 (89)
T PF03088_consen 33 GRPTGRLLRYDPSTKETTVLLDG-LYFPNGVALSPDESFVLVA 74 (89)
T ss_dssp T---EEEEEEETTTTEEEEEEEE-ESSEEEEEE-TTSSEEEEE
T ss_pred CCCCcCEEEEECCCCeEEEehhC-CCccCeEEEcCCCCEEEEE
Confidence 45568899999999876544443 3356899999999987663
No 442
>KOG1916 consensus Nuclear protein, contains WD40 repeats [General function prediction only]
Probab=91.65 E-value=0.34 Score=46.13 Aligned_cols=106 Identities=12% Similarity=0.104 Sum_probs=56.5
Q ss_pred CCcEEEEEcc--CCeeEEEec----CCCCCCeEEEEEec---CCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEE
Q 036605 51 NGDILAVDVL--TGEMKWKST----GRHPGGLAGLAFAK---KGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSS 121 (340)
Q Consensus 51 dg~i~i~d~~--~~~~~~~~~----~~h~~~v~~v~~~~---~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l 121 (340)
-|.+.+|++. .|++...+. ......+.-|.|.| +..++..+..++.|++..+..... ..+.+|...+..+
T Consensus 152 vg~lfVy~vd~l~G~iq~~l~v~~~~p~gs~~~~V~wcp~~~~~~~ic~~~~~~~i~lL~~~ra~~-~l~rsHs~~~~d~ 230 (1283)
T KOG1916|consen 152 VGELFVYDVDVLQGEIQPQLEVTPITPYGSDPQLVSWCPIAVNKVYICYGLKGGEIRLLNINRALR-SLFRSHSQRVTDM 230 (1283)
T ss_pred hhhhheeehHhhccccccceEEeecCcCCCCcceeeecccccccceeeeccCCCceeEeeechHHH-HHHHhcCCCcccH
Confidence 3677888765 344332221 11223344455544 333444455567777766554332 2344566555555
Q ss_pred EEccCCCEEEEecCcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccC
Q 036605 122 AFLCEEKIFALASSEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDI 187 (340)
Q Consensus 122 ~~~~~~~~l~~~~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~ 187 (340)
++-..|-+++.+ ++|||+.++.... ||.+++|.+-+
T Consensus 231 a~~~~g~~~l~~-----------------------------lSpDGtv~a~a~~-dG~v~f~Qiyi 266 (1283)
T KOG1916|consen 231 AFFAEGVLKLAS-----------------------------LSPDGTVFAWAIS-DGSVGFYQIYI 266 (1283)
T ss_pred HHHhhchhhhee-----------------------------eCCCCcEEEEeec-CCccceeeeee
Confidence 544433222111 6788887777666 88888887643
No 443
>TIGR02276 beta_rpt_yvtn 40-residue YVTN family beta-propeller repeat. This repeat of about 40 amino acids is found in up to 14 copies per protein. Archaea Methanosarcina mazei and Methanosarcina acetivorans each have over 10 genes that encode tandem copies of this repeat, which is also found in other species. PSIPRED predicts with high confidence that each 40-residue repeats contains four beta strands. This model overlaps somewhat with the NHL repeat (Pfam pfam01436) and also shows sequence similarity to the WD domain, G-beta repeat (Pfam pfam00400).
Probab=91.63 E-value=1.4 Score=24.41 Aligned_cols=40 Identities=18% Similarity=0.158 Sum_probs=27.9
Q ss_pred cCCCEEEEEe-CCCcEEEEeCCCCeEEEEeecCCCCeeEEEE
Q 036605 83 KKGRSLHVVG-TNGMASEMKSEMGEVIREFKASEKPISSSAF 123 (340)
Q Consensus 83 ~~~~~l~s~~-~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~ 123 (340)
|+++.|+++. .++.|.++|..+++.+..+..... ...++|
T Consensus 1 pd~~~lyv~~~~~~~v~~id~~~~~~~~~i~vg~~-P~~i~~ 41 (42)
T TIGR02276 1 PDGTKLYVTNSGSNTVSVIDTATNKVIATIPVGGY-PFGVAV 41 (42)
T ss_pred CCCCEEEEEeCCCCEEEEEECCCCeEEEEEECCCC-CceEEe
Confidence 5677777765 468999999999888877765432 334444
No 444
>PHA02790 Kelch-like protein; Provisional
Probab=91.55 E-value=11 Score=34.60 Aligned_cols=97 Identities=7% Similarity=-0.030 Sum_probs=47.3
Q ss_pred EEEEEcCC--CcEEEEEccCCeeEEEecCCCCCCe--EEEEEecCCCEEEEEeCC---CcEEEEeCCCCeEEEE--eecC
Q 036605 44 LLALGTSN--GDILAVDVLTGEMKWKSTGRHPGGL--AGLAFAKKGRSLHVVGTN---GMASEMKSEMGEVIRE--FKAS 114 (340)
Q Consensus 44 ~l~~g~~d--g~i~i~d~~~~~~~~~~~~~h~~~v--~~v~~~~~~~~l~s~~~d---g~i~~wd~~~~~~~~~--~~~~ 114 (340)
+.++|+.+ ..+..||..+++... +.. -..+. .+++ .-+|+..+.||.+ ..+..||+.+..-... +...
T Consensus 321 iYviGG~~~~~sve~ydp~~n~W~~-~~~-l~~~r~~~~~~-~~~g~IYviGG~~~~~~~ve~ydp~~~~W~~~~~m~~~ 397 (480)
T PHA02790 321 LYVVGGLPNPTSVERWFHGDAAWVN-MPS-LLKPRCNPAVA-SINNVIYVIGGHSETDTTTEYLLPNHDQWQFGPSTYYP 397 (480)
T ss_pred EEEECCcCCCCceEEEECCCCeEEE-CCC-CCCCCcccEEE-EECCEEEEecCcCCCCccEEEEeCCCCEEEeCCCCCCc
Confidence 66677653 457888877664322 221 11111 1222 2256666666654 3467888876542211 1111
Q ss_pred CCCeeEEEEccCCCEEEEecCcEEEEECCCCc
Q 036605 115 EKPISSSAFLCEEKIFALASSEVRILSLENGE 146 (340)
Q Consensus 115 ~~~i~~l~~~~~~~~l~~~~~~i~i~d~~~~~ 146 (340)
... .++ ..-++++. +.++.+.+||..+.+
T Consensus 398 r~~-~~~-~~~~~~IY-v~GG~~e~ydp~~~~ 426 (480)
T PHA02790 398 HYK-SCA-LVFGRRLF-LVGRNAEFYCESSNT 426 (480)
T ss_pred ccc-ceE-EEECCEEE-EECCceEEecCCCCc
Confidence 111 122 22344444 444567788887664
No 445
>PF10214 Rrn6: RNA polymerase I-specific transcription-initiation factor; InterPro: IPR019350 RNA polymerase I-specific transcription-initiation factor Rrn6 and Rrn7 represent components of a multisubunit transcription factor essential for the initiation of rDNA transcription by Pol I []. These proteins are found in fungi.
Probab=91.40 E-value=15 Score=36.03 Aligned_cols=110 Identities=11% Similarity=0.075 Sum_probs=70.9
Q ss_pred CCeEEEEEec-CCCEEEEEeCCCcEEEEeCCCCeE----EEEee-cCC----------CCeeEEEEccCCCEEEEecCc-
Q 036605 74 GGLAGLAFAK-KGRSLHVVGTNGMASEMKSEMGEV----IREFK-ASE----------KPISSSAFLCEEKIFALASSE- 136 (340)
Q Consensus 74 ~~v~~v~~~~-~~~~l~s~~~dg~i~~wd~~~~~~----~~~~~-~~~----------~~i~~l~~~~~~~~l~~~~~~- 136 (340)
.+..+++|+| +...|+..+..|...||++..... ...+. ... ..-..+.|.++...|+++++.
T Consensus 146 ~~~aDv~FnP~~~~q~AiVD~~G~Wsvw~i~~~~~~~~~~~~~~~~~~gsi~~d~~e~s~w~rI~W~~~~~~lLv~~r~~ 225 (765)
T PF10214_consen 146 FPHADVAFNPWDQRQFAIVDEKGNWSVWDIKGRPKRKSSNLRLSRNISGSIIFDPEELSNWKRILWVSDSNRLLVCNRSK 225 (765)
T ss_pred CccceEEeccCccceEEEEeccCcEEEEEeccccccCCcceeeccCCCccccCCCcccCcceeeEecCCCCEEEEEcCCc
Confidence 3677899998 456899999999999999921111 01111 111 122377888888888777776
Q ss_pred EEEEECCCCceeEEe--ecCCCCeEEEEECCC--CCEEEEEEcCCCeEEEEEcc
Q 036605 137 VRILSLENGEEVLKF--SDDVGPLQYVSASDG--AKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 137 i~i~d~~~~~~~~~~--~~~~~~v~~~~~s~~--~~~l~s~~~~d~~i~iwd~~ 186 (340)
+.++|+.+......+ ......|..+.-++. +..|+. . ...|...++.
T Consensus 226 l~~~d~~~~~~~~~l~~~~~~~~IlDv~~~~~~~~~~FiL--T-s~eiiw~~~~ 276 (765)
T PF10214_consen 226 LMLIDFESNWQTEYLVTAKTWSWILDVKRSPDNPSHVFIL--T-SKEIIWLDVK 276 (765)
T ss_pred eEEEECCCCCccchhccCCChhheeeEEecCCccceEEEE--e-cCeEEEEEcc
Confidence 999999987553212 223467888888877 322322 2 4577777774
No 446
>KOG3630 consensus Nuclear pore complex, Nup214/CAN component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=91.38 E-value=0.37 Score=47.04 Aligned_cols=99 Identities=11% Similarity=0.077 Sum_probs=70.4
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEE-EecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEe
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKW-KSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMK 101 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~-~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd 101 (340)
-..|+.|.|.-- ...++...|+.|++..+....... .+. .....++++|+|.|+.++.|-..|++.-|.
T Consensus 157 f~~~~~wnP~vp--------~n~av~l~dlsl~V~~~~~~~~~v~s~p--~t~~~Tav~WSprGKQl~iG~nnGt~vQy~ 226 (1405)
T KOG3630|consen 157 FQLKNVWNPLVP--------LNSAVDLSDLSLRVKSTKQLAQNVTSFP--VTNSQTAVLWSPRGKQLFIGRNNGTEVQYE 226 (1405)
T ss_pred ccccccccCCcc--------chhhhhccccchhhhhhhhhhhhhcccC--cccceeeEEeccccceeeEecCCCeEEEee
Confidence 457888888752 147778889999988765433221 222 456789999999999999999999999987
Q ss_pred CCCCeEEEEeecC----CCCeeEEEEccCCCEEEE
Q 036605 102 SEMGEVIREFKAS----EKPISSSAFLCEEKIFAL 132 (340)
Q Consensus 102 ~~~~~~~~~~~~~----~~~i~~l~~~~~~~~l~~ 132 (340)
.. ++.+..+.+. ...|.+|.|-....++++
T Consensus 227 P~-leik~~ip~Pp~~e~yrvl~v~Wl~t~eflvv 260 (1405)
T KOG3630|consen 227 PS-LEIKSEIPEPPVEENYRVLSVTWLSTQEFLVV 260 (1405)
T ss_pred cc-cceeecccCCCcCCCcceeEEEEecceeEEEE
Confidence 53 4444333321 357889999888777766
No 447
>KOG2280 consensus Vacuolar assembly/sorting protein VPS16 [Intracellular trafficking, secretion, and vesicular transport]
Probab=91.26 E-value=14 Score=35.16 Aligned_cols=86 Identities=17% Similarity=0.229 Sum_probs=55.7
Q ss_pred CcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEE----eecCCCCeeEEEEccCC
Q 036605 52 GDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIRE----FKASEKPISSSAFLCEE 127 (340)
Q Consensus 52 g~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~----~~~~~~~i~~l~~~~~~ 127 (340)
-.|+||+.. |+.+.++.-.|. .+..+.|+.+. .|+....+|.+.+|++.. +.+.. +......|..+.+..+|
T Consensus 64 ~~I~If~~s-G~lL~~~~w~~~-~lI~mgWs~~e-eLI~v~k~g~v~Vy~~~g-e~ie~~svg~e~~~~~I~ec~~f~~G 139 (829)
T KOG2280|consen 64 PYIRIFNIS-GQLLGRILWKHG-ELIGMGWSDDE-ELICVQKDGTVHVYGLLG-EFIESNSVGFESQMSDIVECRFFHNG 139 (829)
T ss_pred eeEEEEecc-ccchHHHHhcCC-CeeeecccCCc-eEEEEeccceEEEeecch-hhhcccccccccccCceeEEEEecCc
Confidence 358888864 555555554244 88899999654 666779999999999763 32222 12223345556666678
Q ss_pred CEEEEecCcEEEEE
Q 036605 128 KIFALASSEVRILS 141 (340)
Q Consensus 128 ~~l~~~~~~i~i~d 141 (340)
-.+.+.++++.+..
T Consensus 140 Vavlt~~g~v~~i~ 153 (829)
T KOG2280|consen 140 VAVLTVSGQVILIN 153 (829)
T ss_pred eEEEecCCcEEEEc
Confidence 77777888855443
No 448
>KOG3630 consensus Nuclear pore complex, Nup214/CAN component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=90.92 E-value=3.8 Score=40.59 Aligned_cols=109 Identities=10% Similarity=-0.044 Sum_probs=62.2
Q ss_pred CeEEEEEecCCCEEEE--EeCCCcEEEEeCCCCeEEE-----Eeec------CCCCeeEEEEccCCCEE---EEecCcEE
Q 036605 75 GLAGLAFAKKGRSLHV--VGTNGMASEMKSEMGEVIR-----EFKA------SEKPISSSAFLCEEKIF---ALASSEVR 138 (340)
Q Consensus 75 ~v~~v~~~~~~~~l~s--~~~dg~i~~wd~~~~~~~~-----~~~~------~~~~i~~l~~~~~~~~l---~~~~~~i~ 138 (340)
.|..+...+|+...++ .+.+-.|..||++.-..-. -+.- ...-..++.|.|.-..- ...+..|+
T Consensus 102 pi~~~v~~~D~t~s~v~~tsng~~v~~fD~~~fs~s~~~~~~pl~~s~ts~ek~vf~~~~~wnP~vp~n~av~l~dlsl~ 181 (1405)
T KOG3630|consen 102 PIVIFVCFHDATDSVVVSTSNGEAVYSFDLEEFSESRYETTVPLKNSATSFEKPVFQLKNVWNPLVPLNSAVDLSDLSLR 181 (1405)
T ss_pred cceEEEeccCCceEEEEEecCCceEEEEehHhhhhhhhhhccccccccchhccccccccccccCCccchhhhhccccchh
Confidence 4445555566654333 3444578899987543211 0111 11223566777754332 22555566
Q ss_pred EEECCCCcee-EEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 139 ILSLENGEEV-LKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 139 i~d~~~~~~~-~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
+..+...... ..+ ......++++|+|-|+.++.+-. .|++.-|..
T Consensus 182 V~~~~~~~~~v~s~-p~t~~~Tav~WSprGKQl~iG~n-nGt~vQy~P 227 (1405)
T KOG3630|consen 182 VKSTKQLAQNVTSF-PVTNSQTAVLWSPRGKQLFIGRN-NGTEVQYEP 227 (1405)
T ss_pred hhhhhhhhhhhccc-CcccceeeEEeccccceeeEecC-CCeEEEeec
Confidence 6655432221 222 23456899999999999999655 899998886
No 449
>PF11715 Nup160: Nucleoporin Nup120/160; InterPro: IPR021717 Nup120 is conserved from fungi to plants to humans, and is homologous with the Nup160 of vertebrates. The nuclear core complex, or NPC, mediates macromolecular transport across the nuclear envelope. Deletion of the NUP120 gene causes clustering of NPCs at one side of the nuclear envelope, moderate nucleolar fragmentation and slower cell growth []. The vertebrate NPC is estimated to contain between 30 and 60 different proteins. most of which are not known. Two important ones in creating the nucleoporin basket are Nup98 and Nup153, and Nup120, in conjunction with Nup 133, interacts with these two and itself plays a role in mRNA export []. Nup160, Nup133, Nup96, and Nup107 are all targets of phosphorylation. The phosphorylation sites are clustered mainly at the N-terminal regions of these proteins, which are predicted to be natively disordered. The entire Nup107-160 subcomplex is stable throughout the cell cycle, thus it seems unlikely that phosphorylation affects interactions within the Nup107-160 subcomplex, but rather that it regulates the association of the subcomplex with the NPC and other proteins []. ; PDB: 3F7F_D 3H7N_D 3HXR_A.
Probab=90.90 E-value=5.1 Score=37.47 Aligned_cols=71 Identities=15% Similarity=0.182 Sum_probs=45.0
Q ss_pred EEEEEcCCCcEEEEEccC----CeeEEE-e----------cCC----------CCCCeEEEEEec----CCCEEEEEeCC
Q 036605 44 LLALGTSNGDILAVDVLT----GEMKWK-S----------TGR----------HPGGLAGLAFAK----KGRSLHVVGTN 94 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~----~~~~~~-~----------~~~----------h~~~v~~v~~~~----~~~~l~s~~~d 94 (340)
.++++..||.+....... +..... . .+- ..+.+..++++. +..+|++.+.|
T Consensus 160 ~l~v~~~dG~ll~l~~~~~~~~~~~~~~~~~~~~~~~~~l~g~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~tl~~D 239 (547)
T PF11715_consen 160 NLVVSLQDGGLLRLKRSSGDSDGSVWSEELFNDSSWLRSLSGLFPWSYRGDNSSSSVAASLAVSSSEINDDTFLFTLSRD 239 (547)
T ss_dssp BEEEEESSS-EEEEEES----SSS-EE----STHHHHHCCTTTS-TT---SSSS---EEEEEE-----ETTTEEEEEETT
T ss_pred EEEEEECCCCeEEEECCcccCCCCeeEEEEeCCCchhhhhhCcCCcccccCCCCCCccceEEEecceeCCCCEEEEEeCC
Confidence 688888999998887664 211111 1 110 123456666666 67799999999
Q ss_pred CcEEEEeCCCCeEEEEeecC
Q 036605 95 GMASEMKSEMGEVIREFKAS 114 (340)
Q Consensus 95 g~i~~wd~~~~~~~~~~~~~ 114 (340)
+.+++||+.+++.+......
T Consensus 240 ~~LRiW~l~t~~~~~~~~~~ 259 (547)
T PF11715_consen 240 HTLRIWSLETGQCLATIDLL 259 (547)
T ss_dssp SEEEEEETTTTCEEEEEETT
T ss_pred CeEEEEECCCCeEEEEeccc
Confidence 99999999999987776543
No 450
>KOG2247 consensus WD40 repeat-containing protein [General function prediction only]
Probab=90.71 E-value=0.018 Score=50.52 Aligned_cols=142 Identities=13% Similarity=0.129 Sum_probs=93.0
Q ss_pred eEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEE-EeCCCcEEEEeC
Q 036605 24 YSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHV-VGTNGMASEMKS 102 (340)
Q Consensus 24 v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s-~~~dg~i~~wd~ 102 (340)
.-...|-|.+. -++.++.+-.+..||-. ++...... .++....++|..++..++. +-..+.+.+||+
T Consensus 37 pi~~~w~~e~~---------nlavaca~tiv~~YD~a-gq~~le~n--~tg~aldm~wDkegdvlavlAek~~piylwd~ 104 (615)
T KOG2247|consen 37 PIIHRWRPEGH---------NLAVACANTIVIYYDKA-GQVILELN--PTGKALDMAWDKEGDVLAVLAEKTGPIYLWDV 104 (615)
T ss_pred cceeeEecCCC---------ceehhhhhhHHHhhhhh-cceecccC--CchhHhhhhhccccchhhhhhhcCCCeeechh
Confidence 34567888886 58888888899999944 33333333 5667788999887776544 456689999998
Q ss_pred CCCeEEEEeec-CCCCeeEEEEccCCCEEEEecC--cEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCe
Q 036605 103 EMGEVIREFKA-SEKPISSSAFLCEEKIFALASS--EVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKH 179 (340)
Q Consensus 103 ~~~~~~~~~~~-~~~~i~~l~~~~~~~~l~~~~~--~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~ 179 (340)
.+... ..+.. ....-.-+.|++.+..++.+.. .+.+++..+.+.+.....|...++++++.+.+..+.. +. |..
T Consensus 105 n~eyt-qqLE~gg~~s~sll~wsKg~~el~ig~~~gn~viynhgtsR~iiv~Gkh~RRgtq~av~lEd~vil~-dc-d~~ 181 (615)
T KOG2247|consen 105 NSEYT-QQLESGGTSSKSLLAWSKGTPELVIGNNAGNIVIYNHGTSRRIIVMGKHQRRGTQIAVTLEDYVILC-DC-DNT 181 (615)
T ss_pred hhhhH-HHHhccCcchHHHHhhccCCccccccccccceEEEeccchhhhhhhcccccceeEEEecccceeeec-Cc-HHH
Confidence 75431 12211 1112223668888777776543 3999998877666555558888999999988744433 44 444
Q ss_pred E
Q 036605 180 L 180 (340)
Q Consensus 180 i 180 (340)
+
T Consensus 182 L 182 (615)
T KOG2247|consen 182 L 182 (615)
T ss_pred H
Confidence 3
No 451
>KOG1898 consensus Splicing factor 3b, subunit 3 [RNA processing and modification]
Probab=90.45 E-value=16 Score=36.16 Aligned_cols=175 Identities=10% Similarity=0.036 Sum_probs=89.8
Q ss_pred cEEEEEccCCeeEEEecCC---CCCCeEEEEEecCCCE--EEEEeC-----------CCcEEEEeC-CCCeEEEEeecCC
Q 036605 53 DILAVDVLTGEMKWKSTGR---HPGGLAGLAFAKKGRS--LHVVGT-----------NGMASEMKS-EMGEVIREFKASE 115 (340)
Q Consensus 53 ~i~i~d~~~~~~~~~~~~~---h~~~v~~v~~~~~~~~--l~s~~~-----------dg~i~~wd~-~~~~~~~~~~~~~ 115 (340)
.|+++|..+++.+..+.-+ ..-.+..+.|+..+.. +++|.. +|.++.|++ ..|+.+.-+....
T Consensus 854 ~I~~~d~~s~~~~~~~~l~~ne~a~~v~~~~fs~~~~~~~~~v~~~~~~~l~~~~~~~g~~ytyk~~~~g~~lellh~T~ 933 (1205)
T KOG1898|consen 854 SIRVFDPKSGKIICLVELGQNEAAFSVCAVDFSSSEYQPFVAVGVATTEQLDSKSISSGFVYTYKFVRNGDKLELLHKTE 933 (1205)
T ss_pred eEEEEcCCCCceEEEEeecCCcchhheeeeeeccCCCceEEEEEeeccccccccccCCCceEEEEEEecCceeeeeeccC
Confidence 4888898888877666431 1124566667654332 333221 233555543 2333222222111
Q ss_pred CCeeEEEEccCCCEEEE-ecCcEEEEECCCCceeEEe--ecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCc
Q 036605 116 KPISSSAFLCEEKIFAL-ASSEVRILSLENGEEVLKF--SDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTV 192 (340)
Q Consensus 116 ~~i~~l~~~~~~~~l~~-~~~~i~i~d~~~~~~~~~~--~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~ 192 (340)
-+-.-.++.|-..++++ .+..+++||+...+.+++. +.-+..|..+++. +..++.+.. .-.+.++..+....+.
T Consensus 934 ~~~~v~Ai~~f~~~~LagvG~~l~~YdlG~K~lLRk~e~k~~p~~Is~iqt~--~~RI~VgD~-qeSV~~~~y~~~~n~l 1010 (1205)
T KOG1898|consen 934 IPGPVGAICPFQGRVLAGVGRFLRLYDLGKKKLLRKCELKFIPNRISSIQTY--GARIVVGDI-QESVHFVRYRREDNQL 1010 (1205)
T ss_pred CCccceEEeccCCEEEEecccEEEEeeCChHHHHhhhhhccCceEEEEEeec--ceEEEEeec-cceEEEEEEecCCCeE
Confidence 12223455565555555 5666999999988777554 2234566666663 456777666 4445555543222221
Q ss_pred cCCceeeecC-CCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCC
Q 036605 193 NKGPALSMRH-SPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKT 237 (340)
Q Consensus 193 ~~~~~~~~~~-~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~ 237 (340)
. .+.-.. +.++.. +. --|...++.+..-|.+.+-.+..
T Consensus 1011 -~--~fadD~~pR~Vt~---~~-~lD~~tvagaDrfGNi~~vR~P~ 1049 (1205)
T KOG1898|consen 1011 -I--VFADDPVPRHVTA---LE-LLDYDTVAGADRFGNIAVVRIPP 1049 (1205)
T ss_pred -E--EEeCCCccceeeE---EE-EecCCceeeccccCcEEEEECCC
Confidence 1 111111 112222 22 23455678788888888876654
No 452
>smart00564 PQQ beta-propeller repeat. Beta-propeller repeat occurring in enzymes with pyrrolo-quinoline quinone (PQQ) as cofactor, in Ire1p-like Ser/Thr kinases, and in prokaryotic dehydrogenases.
Probab=90.37 E-value=0.8 Score=23.88 Aligned_cols=25 Identities=32% Similarity=0.716 Sum_probs=22.0
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEe
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKS 68 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~ 68 (340)
.+++++.+|.+..+|.++|+..+.+
T Consensus 8 ~v~~~~~~g~l~a~d~~~G~~~W~~ 32 (33)
T smart00564 8 TVYVGSTDGTLYALDAKTGEILWTY 32 (33)
T ss_pred EEEEEcCCCEEEEEEcccCcEEEEc
Confidence 5888899999999999999988764
No 453
>PF14761 HPS3_N: Hermansky-Pudlak syndrome 3
Probab=90.29 E-value=7.9 Score=30.79 Aligned_cols=100 Identities=12% Similarity=0.168 Sum_probs=63.6
Q ss_pred EEEEEcCCCcEEEEEcc--CCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCC---C---cEEEE---eCC--CCeEEE-
Q 036605 44 LLALGTSNGDILAVDVL--TGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTN---G---MASEM---KSE--MGEVIR- 109 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~--~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~d---g---~i~~w---d~~--~~~~~~- 109 (340)
.|+.+.....|.+|++. ..+...++. .-+.|..+.++..|.+|++--.+ . .+++| ... ...++.
T Consensus 30 ~Lfva~~g~~Vev~~l~~~~~~~~~~F~--Tv~~V~~l~y~~~GDYlvTlE~k~~~~~~~fvR~Y~NWr~~~~~~~~v~v 107 (215)
T PF14761_consen 30 ALFVAASGCKVEVYDLEQEECPLLCTFS--TVGRVLQLVYSEAGDYLVTLEEKNKRSPVDFVRAYFNWRSQKEENSPVRV 107 (215)
T ss_pred eEEEEcCCCEEEEEEcccCCCceeEEEc--chhheeEEEeccccceEEEEEeecCCccceEEEEEEEhhhhcccCCcEEE
Confidence 45555778889999988 334566666 45789999999999999996433 2 45554 221 111111
Q ss_pred Eeec---------------------CCCCeeEEEEcc-CCCEEEEecCcEEEEECCCC
Q 036605 110 EFKA---------------------SEKPISSSAFLC-EEKIFALASSEVRILSLENG 145 (340)
Q Consensus 110 ~~~~---------------------~~~~i~~l~~~~-~~~~l~~~~~~i~i~d~~~~ 145 (340)
.+-+ ...++.+++-.| .|++++..++.+.+|.+...
T Consensus 108 RiaG~~v~~~~~~~~~~qleiiElPl~~~p~ciaCC~~tG~LlVg~~~~l~lf~l~~~ 165 (215)
T PF14761_consen 108 RIAGHRVTPSFNESSKDQLEIIELPLSEPPLCIACCPVTGNLLVGCGNKLVLFTLKYQ 165 (215)
T ss_pred EEcccccccCCCCccccceEEEEecCCCCCCEEEecCCCCCEEEEcCCEEEEEEEEEE
Confidence 1111 133556777777 47777777777999987654
No 454
>PLN00033 photosystem II stability/assembly factor; Provisional
Probab=90.25 E-value=13 Score=33.13 Aligned_cols=105 Identities=11% Similarity=0.052 Sum_probs=57.5
Q ss_pred eEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEE-E-EeecCCCCeeEEEEccCCCEEEEecCcEEEEECCCCc-----ee
Q 036605 76 LAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVI-R-EFKASEKPISSSAFLCEEKIFALASSEVRILSLENGE-----EV 148 (340)
Q Consensus 76 v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~-~-~~~~~~~~i~~l~~~~~~~~l~~~~~~i~i~d~~~~~-----~~ 148 (340)
...+..++++.+++.+.....++-||- |... . .-......++.+.+.+++..++++..--.++....++ ..
T Consensus 241 f~~v~~~~dG~~~~vg~~G~~~~s~d~--G~~~W~~~~~~~~~~l~~v~~~~dg~l~l~g~~G~l~~S~d~G~~~~~~~f 318 (398)
T PLN00033 241 FSTVNRSPDGDYVAVSSRGNFYLTWEP--GQPYWQPHNRASARRIQNMGWRADGGLWLLTRGGGLYVSKGTGLTEEDFDF 318 (398)
T ss_pred eeeEEEcCCCCEEEEECCccEEEecCC--CCcceEEecCCCccceeeeeEcCCCCEEEEeCCceEEEecCCCCcccccce
Confidence 344455667666555433333334442 2211 1 1122345678999999999887754444444444443 12
Q ss_pred EEeec--CCCCeEEEEECCCCCEEEEEEcCCCeEEEEE
Q 036605 149 LKFSD--DVGPLQYVSASDGAKIIITAGYGEKHLQVWR 184 (340)
Q Consensus 149 ~~~~~--~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd 184 (340)
..... ....+..+.|.+++..+++ +. .|.+....
T Consensus 319 ~~~~~~~~~~~l~~v~~~~d~~~~a~-G~-~G~v~~s~ 354 (398)
T PLN00033 319 EEADIKSRGFGILDVGYRSKKEAWAA-GG-SGILLRST 354 (398)
T ss_pred eecccCCCCcceEEEEEcCCCcEEEE-EC-CCcEEEeC
Confidence 22211 1235888999988876665 56 67766554
No 455
>PF01011 PQQ: PQQ enzyme repeat family.; InterPro: IPR002372 Pyrrolo-quinoline quinone (PQQ) is a redox coenzyme, which serves as a cofactor for a number of enzymes (quinoproteins) and particularly for some bacterial dehydrogenases [, ]. A number of bacterial quinoproteins belong to this family. Enzymes in this group have repeats of a beta propeller.; PDB: 1H4I_C 1H4J_E 1W6S_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A 1G72_A ....
Probab=90.17 E-value=0.84 Score=24.97 Aligned_cols=27 Identities=33% Similarity=0.589 Sum_probs=23.7
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecC
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTG 70 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~ 70 (340)
.+++++.+|.|+.+|.++|+.++.+..
T Consensus 2 ~v~~~~~~g~l~AlD~~TG~~~W~~~~ 28 (38)
T PF01011_consen 2 RVYVGTPDGYLYALDAKTGKVLWKFQT 28 (38)
T ss_dssp EEEEETTTSEEEEEETTTTSEEEEEES
T ss_pred EEEEeCCCCEEEEEECCCCCEEEeeeC
Confidence 466779999999999999999998865
No 456
>PF14781 BBS2_N: Ciliary BBSome complex subunit 2, N-terminal
Probab=90.08 E-value=5.8 Score=28.90 Aligned_cols=101 Identities=11% Similarity=0.040 Sum_probs=60.5
Q ss_pred EEEEEcCCCcEEEEEccCCe--------eEEEecCCCCCCeEEEEEec-----CCCEEEEEeCCCcEEEEeCCCCeEEEE
Q 036605 44 LLALGTSNGDILAVDVLTGE--------MKWKSTGRHPGGLAGLAFAK-----KGRSLHVVGTNGMASEMKSEMGEVIRE 110 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~--------~~~~~~~~h~~~v~~v~~~~-----~~~~l~s~~~dg~i~~wd~~~~~~~~~ 110 (340)
-|+.++..|.|.|++..... .+..+. -...|++++--+ +...|+.|+ ...+..||+.....+.
T Consensus 12 cL~~aT~~gKV~IH~ph~~~~~~~~~~~~i~~LN--in~~italaaG~l~~~~~~D~LliGt-~t~llaYDV~~N~d~F- 87 (136)
T PF14781_consen 12 CLACATTGGKVFIHNPHERGQRTGRQDSDISFLN--INQEITALAAGRLKPDDGRDCLLIGT-QTSLLAYDVENNSDLF- 87 (136)
T ss_pred eEEEEecCCEEEEECCCccccccccccCceeEEE--CCCceEEEEEEecCCCCCcCEEEEec-cceEEEEEcccCchhh-
Confidence 68888899999999866432 223333 345677776543 233566554 5589999998765432
Q ss_pred eecCCCCeeEEEEcc----CCCEEEEecCc-EEEEECCCCcee
Q 036605 111 FKASEKPISSSAFLC----EEKIFALASSE-VRILSLENGEEV 148 (340)
Q Consensus 111 ~~~~~~~i~~l~~~~----~~~~l~~~~~~-i~i~d~~~~~~~ 148 (340)
++.-...+.++.+-. +..++++++.. |.-||....+..
T Consensus 88 yke~~DGvn~i~~g~~~~~~~~l~ivGGncsi~Gfd~~G~e~f 130 (136)
T PF14781_consen 88 YKEVPDGVNAIVIGKLGDIPSPLVIVGGNCSIQGFDYEGNEIF 130 (136)
T ss_pred hhhCccceeEEEEEecCCCCCcEEEECceEEEEEeCCCCcEEE
Confidence 223345677776642 23444444433 888886655443
No 457
>KOG4460 consensus Nuclear pore complex, Nup88/rNup84 component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=89.44 E-value=16 Score=33.19 Aligned_cols=27 Identities=11% Similarity=0.267 Sum_probs=20.0
Q ss_pred CeEEEEEecCCCEEEEEeCCCcEEEEe
Q 036605 75 GLAGLAFAKKGRSLHVVGTNGMASEMK 101 (340)
Q Consensus 75 ~v~~v~~~~~~~~l~s~~~dg~i~~wd 101 (340)
.|..+..++.|..++-.|.+|.+.++=
T Consensus 105 eV~~vl~s~~GS~VaL~G~~Gi~vMeL 131 (741)
T KOG4460|consen 105 EVYQVLLSPTGSHVALIGIKGLMVMEL 131 (741)
T ss_pred EEEEEEecCCCceEEEecCCeeEEEEc
Confidence 456677788888888888888776553
No 458
>TIGR02604 Piru_Ver_Nterm putative membrane-bound dehydrogenase domain. All proteins that score above the trusted cutoff score of 45 to this model are large proteins of either Pirellula sp. 1 or Verrucomicrobium spinosum. These proteins all contain, in addition to this domain, several hundred residues of highly variable sequence, and then a well-conserved C-terminal domain (TIGR02603) that features a putative cytochrome c-type heme binding motif CXXCH. The membrane-bound L-sorbosone dehydrogenase from Acetobacter liquefaciens (Gluconacetobacter liquefaciens) is homologous to this domain but lacks additional sequence regions shared by members of this family and belongs to a different clade of the larger family of homologs. It and its closely related homologs are excluded from the this model by scoring between the trusted (45) and noise (18) cutoffs.
Probab=89.34 E-value=15 Score=32.43 Aligned_cols=100 Identities=13% Similarity=0.198 Sum_probs=57.9
Q ss_pred CCeEEEEEecCCCEEEEEe-----------CCC-cEEEEeCCC--CeE--EEEeecCCCCeeEEEEccCCCEEEEecCcE
Q 036605 74 GGLAGLAFAKKGRSLHVVG-----------TNG-MASEMKSEM--GEV--IREFKASEKPISSSAFLCEEKIFALASSEV 137 (340)
Q Consensus 74 ~~v~~v~~~~~~~~l~s~~-----------~dg-~i~~wd~~~--~~~--~~~~~~~~~~i~~l~~~~~~~~l~~~~~~i 137 (340)
.....|+|.++|+.+++-. ..+ .|.+++-.+ |+. ...+...-.....+++.+++ ++++....|
T Consensus 14 ~~P~~ia~d~~G~l~V~e~~~y~~~~~~~~~~~~rI~~l~d~dgdG~~d~~~vfa~~l~~p~Gi~~~~~G-lyV~~~~~i 92 (367)
T TIGR02604 14 RNPIAVCFDERGRLWVAEGITYSRPAGRQGPLGDRILILEDADGDGKYDKSNVFAEELSMVTGLAVAVGG-VYVATPPDI 92 (367)
T ss_pred CCCceeeECCCCCEEEEeCCcCCCCCCCCCCCCCEEEEEEcCCCCCCcceeEEeecCCCCccceeEecCC-EEEeCCCeE
Confidence 3467889999888766542 223 777776543 322 23343334456889999999 555554456
Q ss_pred EEE-ECCCC-----c--ee-EEeec----CCCCeEEEEECCCCCEEEEEE
Q 036605 138 RIL-SLENG-----E--EV-LKFSD----DVGPLQYVSASDGAKIIITAG 174 (340)
Q Consensus 138 ~i~-d~~~~-----~--~~-~~~~~----~~~~v~~~~~s~~~~~l~s~~ 174 (340)
..| |.... + .+ ..+.. +......+.|.|||...++.+
T Consensus 93 ~~~~d~~gdg~ad~~~~~l~~~~~~~~~~~~~~~~~l~~gpDG~LYv~~G 142 (367)
T TIGR02604 93 LFLRDKDGDDKADGEREVLLSGFGGQINNHHHSLNSLAWGPDGWLYFNHG 142 (367)
T ss_pred EEEeCCCCCCCCCCccEEEEEccCCCCCcccccccCceECCCCCEEEecc
Confidence 545 44211 1 12 12322 124467899999997766655
No 459
>PF12768 Rax2: Cortical protein marker for cell polarity
Probab=89.20 E-value=12 Score=31.43 Aligned_cols=93 Identities=11% Similarity=0.090 Sum_probs=55.4
Q ss_pred CCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEe------CCCcEEEEeCCCCeEEEEeec-----CCCCee
Q 036605 51 NGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVG------TNGMASEMKSEMGEVIREFKA-----SEKPIS 119 (340)
Q Consensus 51 dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~------~dg~i~~wd~~~~~~~~~~~~-----~~~~i~ 119 (340)
-..|++||..+.+....-.+ -.+.|+++.|..+.+.++.|. ....+..||..+..- ..+.. -..++.
T Consensus 15 C~~lC~yd~~~~qW~~~g~~-i~G~V~~l~~~~~~~Llv~G~ft~~~~~~~~la~yd~~~~~w-~~~~~~~s~~ipgpv~ 92 (281)
T PF12768_consen 15 CPGLCLYDTDNSQWSSPGNG-ISGTVTDLQWASNNQLLVGGNFTLNGTNSSNLATYDFKNQTW-SSLGGGSSNSIPGPVT 92 (281)
T ss_pred CCEEEEEECCCCEeecCCCC-ceEEEEEEEEecCCEEEEEEeeEECCCCceeEEEEecCCCee-eecCCcccccCCCcEE
Confidence 34689999888765544444 678999999986555555553 345678898876642 23333 135677
Q ss_pred EEEEcc-CCCEEEEecC----c--EEEEECCCC
Q 036605 120 SSAFLC-EEKIFALASS----E--VRILSLENG 145 (340)
Q Consensus 120 ~l~~~~-~~~~l~~~~~----~--i~i~d~~~~ 145 (340)
.+.+.. |+..+..++. . |..||-.+-
T Consensus 93 a~~~~~~d~~~~~~aG~~~~g~~~l~~~dGs~W 125 (281)
T PF12768_consen 93 ALTFISNDGSNFWVAGRSANGSTFLMKYDGSSW 125 (281)
T ss_pred EEEeeccCCceEEEeceecCCCceEEEEcCCce
Confidence 776642 3333332211 1 667765443
No 460
>KOG2377 consensus Uncharacterized conserved protein [Function unknown]
Probab=89.19 E-value=3.7 Score=36.43 Aligned_cols=105 Identities=10% Similarity=0.155 Sum_probs=68.5
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecC---CCCCCeEEEEEecCCCEEEEEeCCCc
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTG---RHPGGLAGLAFAKKGRSLHVVGTNGM 96 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~---~h~~~v~~v~~~~~~~~l~s~~~dg~ 96 (340)
..++|.++.||+|.+ .||+--.+.+|.+++....+....+.. .....|.+.+|+.+ .-++.....|
T Consensus 65 d~G~I~SIkFSlDnk---------ilAVQR~~~~v~f~nf~~d~~~l~~~~~ck~k~~~IlGF~W~~s-~e~A~i~~~G- 133 (657)
T KOG2377|consen 65 DKGEIKSIKFSLDNK---------ILAVQRTSKTVDFCNFIPDNSQLEYTQECKTKNANILGFCWTSS-TEIAFITDQG- 133 (657)
T ss_pred CCCceeEEEeccCcc---------eEEEEecCceEEEEecCCCchhhHHHHHhccCcceeEEEEEecC-eeEEEEecCC-
Confidence 346899999999999 999999999999999754332222211 13446899999854 5555555443
Q ss_pred EEEEeCCC-CeEEEEeecCCCCeeEEEEccCCCEEEEecC
Q 036605 97 ASEMKSEM-GEVIREFKASEKPISSSAFLCEEKIFALASS 135 (340)
Q Consensus 97 i~~wd~~~-~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~ 135 (340)
+-+|.... .+.++..+.++..|.=..|.++-+.++.+.+
T Consensus 134 ~e~y~v~pekrslRlVks~~~nvnWy~yc~et~v~LL~t~ 173 (657)
T KOG2377|consen 134 IEFYQVLPEKRSLRLVKSHNLNVNWYMYCPETAVILLSTT 173 (657)
T ss_pred eEEEEEchhhhhhhhhhhcccCccEEEEccccceEeeecc
Confidence 44444322 2234445667777777888888776654433
No 461
>TIGR03032 conserved hypothetical protein TIGR03032. This protein family is uncharacterized. A number of motifs are conserved perfectly among all member sequences. The function of this protein is unknown.
Probab=89.13 E-value=7.9 Score=32.81 Aligned_cols=44 Identities=34% Similarity=0.399 Sum_probs=31.0
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEE
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVV 91 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~ 91 (340)
+.++-+..|.|..+|.++|+...... -++...+++|. |.+++++
T Consensus 215 LwvldsgtGev~~vD~~~G~~e~Va~--vpG~~rGL~f~--G~llvVg 258 (335)
T TIGR03032 215 LWLLNSGRGELGYVDPQAGKFQPVAF--LPGFTRGLAFA--GDFAFVG 258 (335)
T ss_pred EEEEECCCCEEEEEcCCCCcEEEEEE--CCCCCccccee--CCEEEEE
Confidence 77777788888888887776433222 34577888887 7777665
No 462
>PF10214 Rrn6: RNA polymerase I-specific transcription-initiation factor; InterPro: IPR019350 RNA polymerase I-specific transcription-initiation factor Rrn6 and Rrn7 represent components of a multisubunit transcription factor essential for the initiation of rDNA transcription by Pol I []. These proteins are found in fungi.
Probab=88.98 E-value=25 Score=34.58 Aligned_cols=113 Identities=12% Similarity=0.071 Sum_probs=75.6
Q ss_pred CCeEEEEeeccc-cccccccCceEEEEEcCCCcEEEEEccCCe----eEEEecCCCCCC----------eEEEEEecCCC
Q 036605 22 VSYSCLACGFVG-KKRRKERGTLLLALGTSNGDILAVDVLTGE----MKWKSTGRHPGG----------LAGLAFAKKGR 86 (340)
Q Consensus 22 ~~v~~l~~sp~~-~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~----~~~~~~~~h~~~----------v~~v~~~~~~~ 86 (340)
.+...++|+|.. + .||+-...|...||++..+. ....+...+.+. -..+.|.++..
T Consensus 146 ~~~aDv~FnP~~~~---------q~AiVD~~G~Wsvw~i~~~~~~~~~~~~~~~~~~gsi~~d~~e~s~w~rI~W~~~~~ 216 (765)
T PF10214_consen 146 FPHADVAFNPWDQR---------QFAIVDEKGNWSVWDIKGRPKRKSSNLRLSRNISGSIIFDPEELSNWKRILWVSDSN 216 (765)
T ss_pred CccceEEeccCccc---------eEEEEeccCcEEEEEeccccccCCcceeeccCCCccccCCCcccCcceeeEecCCCC
Confidence 466789999877 4 79999999999999992111 111121112233 34788988888
Q ss_pred EEEEEeCCCcEEEEeCCCCeEEE-Ee-ecCCCCeeEEEEccC--CCEEEEecCcEEEEECCC
Q 036605 87 SLHVVGTNGMASEMKSEMGEVIR-EF-KASEKPISSSAFLCE--EKIFALASSEVRILSLEN 144 (340)
Q Consensus 87 ~l~s~~~dg~i~~wd~~~~~~~~-~~-~~~~~~i~~l~~~~~--~~~l~~~~~~i~i~d~~~ 144 (340)
.|+.++.. .+.++|+.+..... .. ......|..+.-+|. ...++.....|...++..
T Consensus 217 ~lLv~~r~-~l~~~d~~~~~~~~~l~~~~~~~~IlDv~~~~~~~~~~FiLTs~eiiw~~~~~ 277 (765)
T PF10214_consen 217 RLLVCNRS-KLMLIDFESNWQTEYLVTAKTWSWILDVKRSPDNPSHVFILTSKEIIWLDVKS 277 (765)
T ss_pred EEEEEcCC-ceEEEECCCCCccchhccCCChhheeeEEecCCccceEEEEecCeEEEEEccC
Confidence 88876654 78899998876533 11 223456888888887 455566777788888776
No 463
>TIGR03606 non_repeat_PQQ dehydrogenase, PQQ-dependent, s-GDH family. PQQ, or pyrroloquinoline-quinone, serves as a cofactor for a number of sugar and alcohol dehydrogenases in a limited number of bacterial species. Most characterized PQQ-dependent enzymes have multiple repeats of a sequence region described by pfam01011 (PQQ enzyme repeat), but this protein family in unusual in lacking that repeat. Below the noise cutoff are related proteins mostly from species that lack PQQ biosynthesis.
Probab=88.12 E-value=20 Score=32.49 Aligned_cols=102 Identities=18% Similarity=0.143 Sum_probs=59.5
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCee--EEEec----CCCCCCeEEEEEecCC------CEEE
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEM--KWKST----GRHPGGLAGLAFAKKG------RSLH 89 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~--~~~~~----~~h~~~v~~v~~~~~~------~~l~ 89 (340)
..-+.|+|.|+++ +|++--..|.|++++..++.. +..+. ....+....|+++|+- .+|+
T Consensus 30 ~~Pw~maflPDG~---------llVtER~~G~I~~v~~~~~~~~~~~~l~~v~~~~ge~GLlglal~PdF~~~~~n~~lY 100 (454)
T TIGR03606 30 NKPWALLWGPDNQ---------LWVTERATGKILRVNPETGEVKVVFTLPEIVNDAQHNGLLGLALHPDFMQEKGNPYVY 100 (454)
T ss_pred CCceEEEEcCCCe---------EEEEEecCCEEEEEeCCCCceeeeecCCceeccCCCCceeeEEECCCccccCCCcEEE
Confidence 4567899999999 666554469999998655432 21121 1135678999999874 3455
Q ss_pred EEe----------CCCcEEEEeCCCC--e---EEEEeecC----CCCeeEEEEccCCCEEEE
Q 036605 90 VVG----------TNGMASEMKSEMG--E---VIREFKAS----EKPISSSAFLCEEKIFAL 132 (340)
Q Consensus 90 s~~----------~dg~i~~wd~~~~--~---~~~~~~~~----~~~i~~l~~~~~~~~l~~ 132 (340)
... ....|..|.+... . ....+... ...-..|+|.|||.++++
T Consensus 101 vsyt~~~~~~~~~~~~~I~R~~l~~~~~~l~~~~~Il~~lP~~~~H~GgrI~FgPDG~LYVs 162 (454)
T TIGR03606 101 ISYTYKNGDKELPNHTKIVRYTYDKSTQTLEKPVDLLAGLPAGNDHNGGRLVFGPDGKIYYT 162 (454)
T ss_pred EEEeccCCCCCccCCcEEEEEEecCCCCccccceEEEecCCCCCCcCCceEEECCCCcEEEE
Confidence 542 1234555554321 1 11122211 122457889999987765
No 464
>TIGR03548 mutarot_permut cyclically-permuted mutatrotase family protein. Members of this protein family show essentially full-length homology, cyclically permuted, to YjhT from Escherichia coli. YjhT was shown to act as a mutarotase for sialic acid, and by this ability to be able to act as a virulence factor. Members of the YjhT family (TIGR03547) and this cyclically-permuted family have multiple repeats of the beta-propeller-forming Kelch repeat.
Probab=87.93 E-value=17 Score=31.34 Aligned_cols=99 Identities=10% Similarity=0.105 Sum_probs=45.3
Q ss_pred CCCEEEEEeCC-----CcEEEEeCCCCeEE---EEeecCCCCe--eEEEEccCCCEEEEecC-------cEEEEECCCCc
Q 036605 84 KGRSLHVVGTN-----GMASEMKSEMGEVI---REFKASEKPI--SSSAFLCEEKIFALASS-------EVRILSLENGE 146 (340)
Q Consensus 84 ~~~~l~s~~~d-----g~i~~wd~~~~~~~---~~~~~~~~~i--~~l~~~~~~~~l~~~~~-------~i~i~d~~~~~ 146 (340)
++..++.|+.+ ..+..+|+.+.+-. ..+..-..+. .+++. -++++.+.++. ++..||+.+.+
T Consensus 72 ~~~lyviGG~~~~~~~~~v~~~d~~~~~w~~~~~~~~~lp~~~~~~~~~~-~~~~iYv~GG~~~~~~~~~v~~yd~~~~~ 150 (323)
T TIGR03548 72 ENGIYYIGGSNSSERFSSVYRITLDESKEELICETIGNLPFTFENGSACY-KDGTLYVGGGNRNGKPSNKSYLFNLETQE 150 (323)
T ss_pred CCEEEEEcCCCCCCCceeEEEEEEcCCceeeeeeEcCCCCcCccCceEEE-ECCEEEEEeCcCCCccCceEEEEcCCCCC
Confidence 45566666654 35667777665431 1221111111 12222 24555555543 38889988764
Q ss_pred eeE--EeecCCCCeEEEEECCCCCEEEEEEcCCC----eEEEEEc
Q 036605 147 EVL--KFSDDVGPLQYVSASDGAKIIITAGYGEK----HLQVWRC 185 (340)
Q Consensus 147 ~~~--~~~~~~~~v~~~~~s~~~~~l~s~~~~d~----~i~iwd~ 185 (340)
-.. .+... ......+...+++..+.++. ++ .+.+||.
T Consensus 151 W~~~~~~p~~-~r~~~~~~~~~~~iYv~GG~-~~~~~~~~~~yd~ 193 (323)
T TIGR03548 151 WFELPDFPGE-PRVQPVCVKLQNELYVFGGG-SNIAYTDGYKYSP 193 (323)
T ss_pred eeECCCCCCC-CCCcceEEEECCEEEEEcCC-CCccccceEEEec
Confidence 321 12111 11122222334556666554 32 2456776
No 465
>PF07995 GSDH: Glucose / Sorbosone dehydrogenase; InterPro: IPR012938 Proteins containing this domain are thought to be glucose/sorbosone dehydrogenases. The best characterised of these proteins is soluble glucose dehydrogenase (P13650 from SWISSPROT) from Acinetobacter calcoaceticus, which oxidises glucose to gluconolactone. The enzyme is a calcium-dependent homodimer which uses PQQ as a cofactor [].; GO: 0016901 oxidoreductase activity, acting on the CH-OH group of donors, quinone or similar compound as acceptor, 0048038 quinone binding, 0005975 carbohydrate metabolic process; PDB: 2ISM_A 2WG3_D 3HO5_A 3HO4_A 3HO3_A 2WFT_A 2WG4_B 2WFX_B 1CRU_A 1CQ1_B ....
Probab=87.85 E-value=17 Score=31.48 Aligned_cols=99 Identities=17% Similarity=0.259 Sum_probs=54.7
Q ss_pred CeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeE---EEEe----ecCCCCeeEEEEccC----CCEEEEec-C-------
Q 036605 75 GLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEV---IREF----KASEKPISSSAFLCE----EKIFALAS-S------- 135 (340)
Q Consensus 75 ~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~---~~~~----~~~~~~i~~l~~~~~----~~~l~~~~-~------- 135 (340)
..+.|+|.|+|..+++ ...|.|.+++ ..+.. +..+ .........++++|+ +.+.+... .
T Consensus 3 ~P~~~a~~pdG~l~v~-e~~G~i~~~~-~~g~~~~~v~~~~~v~~~~~~gllgia~~p~f~~n~~lYv~~t~~~~~~~~~ 80 (331)
T PF07995_consen 3 NPRSMAFLPDGRLLVA-ERSGRIWVVD-KDGSLKTPVADLPEVFADGERGLLGIAFHPDFASNGYLYVYYTNADEDGGDN 80 (331)
T ss_dssp SEEEEEEETTSCEEEE-ETTTEEEEEE-TTTEECEEEEE-TTTBTSTTBSEEEEEE-TTCCCC-EEEEEEEEE-TSSSSE
T ss_pred CceEEEEeCCCcEEEE-eCCceEEEEe-CCCcCcceecccccccccccCCcccceeccccCCCCEEEEEEEcccCCCCCc
Confidence 3578999999876664 6799999999 44543 2222 123456789999995 33333311 1
Q ss_pred --cEEEEECCCC-------cee-EEeec---CCCCeEEEEECCCCCEEEEEEc
Q 036605 136 --EVRILSLENG-------EEV-LKFSD---DVGPLQYVSASDGAKIIITAGY 175 (340)
Q Consensus 136 --~i~i~d~~~~-------~~~-~~~~~---~~~~v~~~~~s~~~~~l~s~~~ 175 (340)
.|.-|.+..+ +.+ ..+.. .......|.|.|||...++.+.
T Consensus 81 ~~~v~r~~~~~~~~~~~~~~~l~~~~p~~~~~~H~g~~l~fgpDG~LYvs~G~ 133 (331)
T PF07995_consen 81 DNRVVRFTLSDGDGDLSSEEVLVTGLPDTSSGNHNGGGLAFGPDGKLYVSVGD 133 (331)
T ss_dssp EEEEEEEEEETTSCEEEEEEEEEEEEES-CSSSS-EEEEEE-TTSEEEEEEB-
T ss_pred ceeeEEEeccCCccccccceEEEEEeCCCCCCCCCCccccCCCCCcEEEEeCC
Confidence 1444444333 111 12222 2344567999999976666655
No 466
>TIGR03032 conserved hypothetical protein TIGR03032. This protein family is uncharacterized. A number of motifs are conserved perfectly among all member sequences. The function of this protein is unknown.
Probab=87.76 E-value=16 Score=31.03 Aligned_cols=70 Identities=13% Similarity=0.094 Sum_probs=42.4
Q ss_pred EEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEe
Q 036605 56 AVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALA 133 (340)
Q Consensus 56 i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~ 133 (340)
++|+.+++.+.. + . ....+..|+ +|++.++-+..|.+..+|.++|+....... .+....++|. |.+++++
T Consensus 189 vidv~s~evl~~--G-L-smPhSPRWh-dgrLwvldsgtGev~~vD~~~G~~e~Va~v-pG~~rGL~f~--G~llvVg 258 (335)
T TIGR03032 189 VIDIPSGEVVAS--G-L-SMPHSPRWY-QGKLWLLNSGRGELGYVDPQAGKFQPVAFL-PGFTRGLAFA--GDFAFVG 258 (335)
T ss_pred EEEeCCCCEEEc--C-c-cCCcCCcEe-CCeEEEEECCCCEEEEEcCCCCcEEEEEEC-CCCCccccee--CCEEEEE
Confidence 356666654421 1 1 122344565 577777777889999999988865444332 3456778887 7777653
No 467
>KOG3616 consensus Selective LIM binding factor [Transcription]
Probab=87.69 E-value=9.3 Score=36.30 Aligned_cols=150 Identities=17% Similarity=0.137 Sum_probs=80.5
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEE
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEM 100 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~w 100 (340)
...++++.-+|.+. -++.+..||.|++|+....+...... ...+-..+.|...| |++...|..+.-|
T Consensus 14 ~e~~~aiqshp~~~---------s~v~~~~d~si~lfn~~~r~qski~~--~~~p~~nlv~tnhg--l~~~tsdrr~la~ 80 (1636)
T KOG3616|consen 14 DEFTTAIQSHPGGQ---------SFVLAHQDGSIILFNFIPRRQSKICE--EAKPKENLVFTNHG--LVTATSDRRALAW 80 (1636)
T ss_pred cceeeeeeecCCCc---------eEEEEecCCcEEEEeecccchhhhhh--hcCCccceeeeccc--eEEEeccchhhee
Confidence 35677888889887 79999999999999987655422222 12233455555333 5666677777777
Q ss_pred eCCCCeEEEEeec---CCCCeeEEEEccCCCEE---------------------------EEecCcEEEEECCCCceeEE
Q 036605 101 KSEMGEVIREFKA---SEKPISSSAFLCEEKIF---------------------------ALASSEVRILSLENGEEVLK 150 (340)
Q Consensus 101 d~~~~~~~~~~~~---~~~~i~~l~~~~~~~~l---------------------------~~~~~~i~i~d~~~~~~~~~ 150 (340)
.- +|-..+.|.- .....+++...|..+.+ .++-..|.+-|+.++.....
T Consensus 81 ~~-dgvvqqqfdyndqsekefss~~cdptaqnvvgtlcggv~q~dcclrr~i~knkfe~tyv~pshvilkdlsn~trt~l 159 (1636)
T KOG3616|consen 81 KE-DGVVQQQFDYNDQSEKEFSSILCDPTAQNVVGTLCGGVEQFDCCLRRGILKNKFELTYVAPSHVILKDLSNDTRTNL 159 (1636)
T ss_pred ec-cCcchhhccccchhhhhccceecCchhhhhhhhhccceeeehHHHHhHHHhccceeEEeccceeeeecccCCceEee
Confidence 52 3333222221 11122233333322211 12233355566666544433
Q ss_pred eecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEcc
Q 036605 151 FSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 151 ~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
.....-.|..+.+....+|++. .. ..+|.+=|+.
T Consensus 160 ~s~~g~aidelkilgkdryli~-~t-s~siii~d~e 193 (1636)
T KOG3616|consen 160 ISHKGLAIDELKILGKDRYLIA-HT-SESIIIADLE 193 (1636)
T ss_pred eecCCcchhhhhhccccceEEe-ec-cccEEEeecc
Confidence 3322234455555555667766 33 4677777873
No 468
>PF07250 Glyoxal_oxid_N: Glyoxal oxidase N-terminus; InterPro: IPR009880 This entry represents the N terminus (approximately 300 residues) of a number of plant and fungal glyoxal oxidase enzymes. Glyoxal oxidase catalyses the oxidation of aldehydes to carboxylic acids, coupled with reduction of dioxygen to hydrogen peroxide. It is an essential component of the extracellular lignin degradation pathways of the wood-rot fungus Phanerochaete chrysosporium [].
Probab=87.64 E-value=10 Score=31.04 Aligned_cols=88 Identities=11% Similarity=0.211 Sum_probs=49.5
Q ss_pred EEEEeCCCCeEEEEeecCCCCeeEEEEccCCCEEEEecCc-----EEEEECCCCceeEEe------ecCCCCeEEEEECC
Q 036605 97 ASEMKSEMGEVIREFKASEKPISSSAFLCEEKIFALASSE-----VRILSLENGEEVLKF------SDDVGPLQYVSASD 165 (340)
Q Consensus 97 i~~wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~-----i~i~d~~~~~~~~~~------~~~~~~v~~~~~s~ 165 (340)
-.+||+.+++....-.....-..+-++-+||+++.+++.. +++++.........+ -...-+-..+..-+
T Consensus 48 s~~yD~~tn~~rpl~v~td~FCSgg~~L~dG~ll~tGG~~~G~~~ir~~~p~~~~~~~~w~e~~~~m~~~RWYpT~~~L~ 127 (243)
T PF07250_consen 48 SVEYDPNTNTFRPLTVQTDTFCSGGAFLPDGRLLQTGGDNDGNKAIRIFTPCTSDGTCDWTESPNDMQSGRWYPTATTLP 127 (243)
T ss_pred EEEEecCCCcEEeccCCCCCcccCcCCCCCCCEEEeCCCCccccceEEEecCCCCCCCCceECcccccCCCccccceECC
Confidence 3588988876533211122223334577899999885432 888886541111111 11122334455678
Q ss_pred CCCEEEEEEcCCCeEEEEE
Q 036605 166 GAKIIITAGYGEKHLQVWR 184 (340)
Q Consensus 166 ~~~~l~s~~~~d~~i~iwd 184 (340)
||+.|+.+|.......+|.
T Consensus 128 DG~vlIvGG~~~~t~E~~P 146 (243)
T PF07250_consen 128 DGRVLIVGGSNNPTYEFWP 146 (243)
T ss_pred CCCEEEEeCcCCCcccccC
Confidence 9999999888544455554
No 469
>PF13449 Phytase-like: Esterase-like activity of phytase
Probab=87.61 E-value=18 Score=31.31 Aligned_cols=103 Identities=15% Similarity=0.263 Sum_probs=64.7
Q ss_pred CCCCeEEEEEecCCCEEEEEeCCCc------EEEEeCCC--C--eEEE-----EeecCCC--------CeeEEEEccCCC
Q 036605 72 HPGGLAGLAFAKKGRSLHVVGTNGM------ASEMKSEM--G--EVIR-----EFKASEK--------PISSSAFLCEEK 128 (340)
Q Consensus 72 h~~~v~~v~~~~~~~~l~s~~~dg~------i~~wd~~~--~--~~~~-----~~~~~~~--------~i~~l~~~~~~~ 128 (340)
.-+.+..+.+.+++..+++.+++|. +..+++.. + ..+. .+....+ ...+|++.+++.
T Consensus 18 ~~GGlSgl~~~~~~~~~~avSD~g~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~L~~~~G~~~~~~~~D~Egi~~~~~g~ 97 (326)
T PF13449_consen 18 PFGGLSGLDYDPDDGRFYAVSDRGPNKGPPRFYTFRIDYDQGGIGGVTILDMIPLRDPDGQPFPKNGLDPEGIAVPPDGS 97 (326)
T ss_pred ccCcEeeEEEeCCCCEEEEEECCCCCCCCCcEEEEEeeccCCCccceEeccceeccCCCCCcCCcCCCChhHeEEecCCC
Confidence 4567889999977777888888888 66665543 1 0111 1111111 344788888888
Q ss_pred EEEE--ec------CcEEEEECCCCceeEEee---------------cCCCCeEEEEECCCCCEEEEEEc
Q 036605 129 IFAL--AS------SEVRILSLENGEEVLKFS---------------DDVGPLQYVSASDGAKIIITAGY 175 (340)
Q Consensus 129 ~l~~--~~------~~i~i~d~~~~~~~~~~~---------------~~~~~v~~~~~s~~~~~l~s~~~ 175 (340)
++++ .+ ..|+.++.. |+.+..+. .......+|+++|+|+.|+++..
T Consensus 98 ~~is~E~~~~~~~~p~I~~~~~~-G~~~~~~~vP~~~~~~~~~~~~~~~N~G~E~la~~~dG~~l~~~~E 166 (326)
T PF13449_consen 98 FWISSEGGRTGGIPPRIRRFDLD-GRVIRRFPVPAAFLPDANGTSGRRNNRGFEGLAVSPDGRTLFAAME 166 (326)
T ss_pred EEEEeCCccCCCCCCEEEEECCC-CcccceEccccccccccCccccccCCCCeEEEEECCCCCEEEEEEC
Confidence 8887 33 337777766 55543331 12356789999999997776544
No 470
>PF12657 TFIIIC_delta: Transcription factor IIIC subunit delta N-term; InterPro: IPR024761 This entry represents a domain found towards the N terminus of the 90 kDa subunit of transcription factor IIIC (also known as subunit 9 in yeast []). The whole subunit is involved in RNA polymerase III-mediated transcription. It is possible that this N-terminal domain interacts with TFIIIC subunit 8 [].
Probab=87.44 E-value=8.4 Score=29.70 Aligned_cols=25 Identities=16% Similarity=0.159 Sum_probs=18.1
Q ss_pred CeeEEEEccCCCEEEEecCcEEEEE
Q 036605 117 PISSSAFLCEEKIFALASSEVRILS 141 (340)
Q Consensus 117 ~i~~l~~~~~~~~l~~~~~~i~i~d 141 (340)
...+|+||.||++.++++..|.|.+
T Consensus 6 ~~~~l~WS~Dg~laV~t~~~v~IL~ 30 (173)
T PF12657_consen 6 CPNALAWSEDGQLAVATGESVHILD 30 (173)
T ss_pred CCcCeeECCCCCEEEEcCCeEEEEe
Confidence 3467888888877777777777773
No 471
>COG5276 Uncharacterized conserved protein [Function unknown]
Probab=86.45 E-value=18 Score=30.33 Aligned_cols=105 Identities=9% Similarity=-0.037 Sum_probs=64.2
Q ss_pred CCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEeecC--CCCeeEEEEccCCCEEEEecCc--EEEEECCCCcee-
Q 036605 74 GGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFKAS--EKPISSSAFLCEEKIFALASSE--VRILSLENGEEV- 148 (340)
Q Consensus 74 ~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~~~--~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~- 148 (340)
+-+..+.++ +++.+.+..+.-+++.|+.+-........- .+-..++.+ .|+++.+++-+ +.++|+.+....
T Consensus 87 ~l~~Dv~vs--e~yvyvad~ssGL~IvDIS~P~sP~~~~~lnt~gyaygv~v--sGn~aYVadlddgfLivdvsdpssP~ 162 (370)
T COG5276 87 DLFADVRVS--EEYVYVADWSSGLRIVDISTPDSPTLIGFLNTDGYAYGVYV--SGNYAYVADLDDGFLIVDVSDPSSPQ 162 (370)
T ss_pred hhhheeEec--ccEEEEEcCCCceEEEeccCCCCcceeccccCCceEEEEEe--cCCEEEEeeccCcEEEEECCCCCCce
Confidence 455666776 678888888888999998875533222111 122344444 46677665533 778888765332
Q ss_pred --EEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 149 --LKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 149 --~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
..+......-..++.|. ++-+.+.. |+-+.|-|+
T Consensus 163 lagrya~~~~d~~~v~ISG--n~AYvA~~-d~GL~ivDV 198 (370)
T COG5276 163 LAGRYALPGGDTHDVAISG--NYAYVAWR-DGGLTIVDV 198 (370)
T ss_pred eeeeeccCCCCceeEEEec--CeEEEEEe-CCCeEEEEc
Confidence 33333334446677754 45555556 888999998
No 472
>smart00564 PQQ beta-propeller repeat. Beta-propeller repeat occurring in enzymes with pyrrolo-quinoline quinone (PQQ) as cofactor, in Ire1p-like Ser/Thr kinases, and in prokaryotic dehydrogenases.
Probab=86.44 E-value=2 Score=22.27 Aligned_cols=26 Identities=19% Similarity=0.420 Sum_probs=21.5
Q ss_pred CEEEEEeCCCcEEEEeCCCCeEEEEe
Q 036605 86 RSLHVVGTNGMASEMKSEMGEVIREF 111 (340)
Q Consensus 86 ~~l~s~~~dg~i~~wd~~~~~~~~~~ 111 (340)
..++.++.+|.+..+|..+|+.+..+
T Consensus 7 ~~v~~~~~~g~l~a~d~~~G~~~W~~ 32 (33)
T smart00564 7 GTVYVGSTDGTLYALDAKTGEILWTY 32 (33)
T ss_pred CEEEEEcCCCEEEEEEcccCcEEEEc
Confidence 36888889999999999999876543
No 473
>PF10395 Utp8: Utp8 family; InterPro: IPR018843 Utp8 is an essential component of the nuclear tRNA export machinery in Saccharomyces cerevisiae (Baker's yeast). It is a tRNA binding protein that acts at a step between tRNA maturation /aminoacylation, and translocation of the tRNA across the nuclear pore complex [].
Probab=86.07 E-value=32 Score=32.70 Aligned_cols=159 Identities=15% Similarity=0.167 Sum_probs=81.2
Q ss_pred CCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEE--EeecC-CC-CeeEEEEcc------CCCEEEE-ec--Cc--
Q 036605 72 HPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIR--EFKAS-EK-PISSSAFLC------EEKIFAL-AS--SE-- 136 (340)
Q Consensus 72 h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~--~~~~~-~~-~i~~l~~~~------~~~~l~~-~~--~~-- 136 (340)
-.+.|.++.|.++++.+++.-.+|.|.+||...+.... .++.. .. -+++ .|-+ ...++++ +. ++
T Consensus 128 l~~kvv~Ik~~~~~~~I~vvl~nG~i~~~d~~~~~l~~~~~l~~~~~~~v~ys-~fv~~~~~~~~~~~ll~v~~~~~~k~ 206 (670)
T PF10395_consen 128 LDDKVVGIKFSSDGKIIYVVLENGSIQIYDFSENSLEKVPQLKLKSSINVSYS-KFVNDFELENGKDLLLTVSQLSNSKL 206 (670)
T ss_pred cccceEEEEEecCCCEEEEEEcCCcEEEEeccccccccccccccccccceehh-hhhcccccccCCceEEEEEEcCCCcE
Confidence 35689999999999999999999999999993332111 12111 11 1111 1111 1233333 22 22
Q ss_pred -EEEEECC-CCceeEEee---cCCCCeE--EEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceee-ecCCC--ee
Q 036605 137 -VRILSLE-NGEEVLKFS---DDVGPLQ--YVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALS-MRHSP--VA 206 (340)
Q Consensus 137 -i~i~d~~-~~~~~~~~~---~~~~~v~--~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~-~~~~~--~~ 206 (340)
.+++.+. ....+..+. .+..... .+++. +|. |+-- . ++.|.+|++ ...+....+.++ +-... ..
T Consensus 207 ~ykL~~l~~~~~~~~El~s~~~e~~~~~~s~f~Y~-~G~-LY~l-~-~~~i~~ysi--p~f~~~~tI~l~~ii~~~~~~~ 280 (670)
T PF10395_consen 207 SYKLISLSNESSSIFELSSTILENFGLEDSKFCYQ-FGK-LYQL-S-KKTISSYSI--PNFQIQKTISLPSIIDKESDDL 280 (670)
T ss_pred EEEEEEeccCCcceEEeehheeccCCcccceEEEe-CCE-EEEE-e-CCEEEEEEc--CCceEEEEEEechhhccccccc
Confidence 7888871 122233332 1122222 23333 443 3332 3 789999998 444433333333 11111 12
Q ss_pred eeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 207 IDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 207 ~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
+.+ .++...+++.+ .++.|++.|+.-...+.
T Consensus 281 vSl----~~~s~nRvLLs-~~nkIyLld~~~~siLs 311 (670)
T PF10395_consen 281 VSL----KPPSPNRVLLS-VNNKIYLLDLKFESILS 311 (670)
T ss_pred eEe----ecCCCCeEEEE-cCCEEEEEeehhhhhhh
Confidence 222 14555556554 46679999987644433
No 474
>PF07676 PD40: WD40-like Beta Propeller Repeat; InterPro: IPR011659 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events. This region appears to be related to the IPR001680 from INTERPRO repeat. This model is likely to miss copies within a sequence.; PDB: 2HQS_D 1C5K_A 2IVZ_A 2W8B_D 3IAX_A 1CRZ_A 1N6F_D 1N6D_C 1N6E_C 1K32_A ....
Probab=86.04 E-value=3.9 Score=22.22 Aligned_cols=29 Identities=21% Similarity=0.335 Sum_probs=19.5
Q ss_pred CCCCeEEEEEecCCCEEEEEeC-C--CcEEEE
Q 036605 72 HPGGLAGLAFAKKGRSLHVVGT-N--GMASEM 100 (340)
Q Consensus 72 h~~~v~~v~~~~~~~~l~s~~~-d--g~i~~w 100 (340)
..+.-....|+|||+.|+.++. + |...+|
T Consensus 7 ~~~~~~~p~~SpDGk~i~f~s~~~~~g~~diy 38 (39)
T PF07676_consen 7 SPGDDGSPAWSPDGKYIYFTSNRNDRGSFDIY 38 (39)
T ss_dssp SSSSEEEEEE-TTSSEEEEEEECT--SSEEEE
T ss_pred CCccccCEEEecCCCEEEEEecCCCCCCcCEE
Confidence 5567788999999998777654 3 444444
No 475
>TIGR03118 PEPCTERM_chp_1 conserved hypothetical protein TIGR03118. This model describes and uncharacterized conserved hypothetical protein. Members are found with the C-terminal putative exosortase interaction domain, PEP-CTERM, in Nitrosospira multiformis, Rhodoferax ferrireducens, Solibacter usitatus Ellin6076, and Acidobacteria bacterium Ellin345. It is found without the PEP-CTERM domain in several other species, including Burkholderia ambifaria, Gloeobacter violaceus PCC 7421, and three copies in the Acanthamoeba polyphaga mimivirus.
Probab=85.44 E-value=21 Score=30.16 Aligned_cols=207 Identities=14% Similarity=0.110 Sum_probs=109.7
Q ss_pred CeEEEEeeccccccccccCceEEEEEcCCCcEEEEEcc------CC-eeEEEecC----CCCCCeEEEEEecCCC-----
Q 036605 23 SYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVL------TG-EMKWKSTG----RHPGGLAGLAFAKKGR----- 86 (340)
Q Consensus 23 ~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~------~~-~~~~~~~~----~h~~~v~~v~~~~~~~----- 86 (340)
.-+.|+++|.+. +-++....+...+||.. .. .++-.+.. ...+..+.+.|+....
T Consensus 24 N~WGia~~p~~~---------~WVadngT~~~TlYdg~~~~~~g~~~~L~vtiP~~~~~~~~~~PTGiVfN~~~~F~vt~ 94 (336)
T TIGR03118 24 NAWGLSYRPGGP---------FWVANTGTGTATLYVGNPDTQPLVQDPLVVVIPAPPPLAAEGTPTGQVFNGSDTFVVSG 94 (336)
T ss_pred ccceeEecCCCC---------EEEecCCcceEEeecCCcccccCCccceEEEecCCCCCCCCCCccEEEEeCCCceEEcC
Confidence 346799999888 78888888999999986 12 22333331 1234678888874322
Q ss_pred -------EEEEEeCCCcEEEEeCCCCeE-----EEEeecC-CCCe-eEEEEc--cCCCEEEEec---CcEEEEECCCCce
Q 036605 87 -------SLHVVGTNGMASEMKSEMGEV-----IREFKAS-EKPI-SSSAFL--CEEKIFALAS---SEVRILSLENGEE 147 (340)
Q Consensus 87 -------~l~s~~~dg~i~~wd~~~~~~-----~~~~~~~-~~~i-~~l~~~--~~~~~l~~~~---~~i~i~d~~~~~~ 147 (340)
.++.+++||+|.-|...-+.. ...+... ...+ ..+++. ..+.+|+.++ ++|.+||-.-.+.
T Consensus 95 ~g~~~~a~Fif~tEdGTisaW~p~v~~t~~~~~~~~~d~s~~gavYkGLAi~~~~~~~~LYaadF~~g~IDVFd~~f~~~ 174 (336)
T TIGR03118 95 EGITGPSRFLFVTEDGTLSGWAPALGTTRMTRAEIVVDASQQGNVYKGLAVGPTGGGDYLYAANFRQGRIDVFKGSFRPP 174 (336)
T ss_pred CCcccceeEEEEeCCceEEeecCcCCcccccccEEEEccCCCcceeeeeEEeecCCCceEEEeccCCCceEEecCccccc
Confidence 357789999999998543322 1122211 1223 345544 3356665543 4488887543221
Q ss_pred e--EEeecCC-----CC-----------eEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCcee-eecCCCeeee
Q 036605 148 V--LKFSDDV-----GP-----------LQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPAL-SMRHSPVAID 208 (340)
Q Consensus 148 ~--~~~~~~~-----~~-----------v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~-~~~~~~~~~~ 208 (340)
. ..|.... .+ |+-..-.++...=+. +..-|.|.+||. .+..++.+.. ..-..++-+.
T Consensus 175 ~~~g~F~DP~iPagyAPFnIqnig~~lyVtYA~qd~~~~d~v~-G~G~G~VdvFd~---~G~l~~r~as~g~LNaPWG~a 250 (336)
T TIGR03118 175 PLPGSFIDPALPAGYAPFNVQNLGGTLYVTYAQQDADRNDEVA-GAGLGYVNVFTL---NGQLLRRVASSGRLNAPWGLA 250 (336)
T ss_pred cCCCCccCCCCCCCCCCcceEEECCeEEEEEEecCCccccccc-CCCcceEEEEcC---CCcEEEEeccCCcccCCceee
Confidence 1 1111100 00 111111222222222 222578999997 3333322210 0012233333
Q ss_pred ee-cCCCCCCCCEEEEEeCCCcEEEEECCCCCccC
Q 036605 209 CK-NSPNGEDGTVILAVAESGVAYSWDLKTVSQDE 242 (340)
Q Consensus 209 ~~-~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~ 242 (340)
.. ..|....+.+|+.--.||+|..||..+++.+.
T Consensus 251 ~APa~FG~~sg~lLVGNFGDG~InaFD~~sG~~~g 285 (336)
T TIGR03118 251 IAPESFGSLSGALLVGNFGDGTINAYDPQSGAQLG 285 (336)
T ss_pred eChhhhCCCCCCeEEeecCCceeEEecCCCCceee
Confidence 31 12335667777777789999999998876555
No 476
>TIGR02276 beta_rpt_yvtn 40-residue YVTN family beta-propeller repeat. This repeat of about 40 amino acids is found in up to 14 copies per protein. Archaea Methanosarcina mazei and Methanosarcina acetivorans each have over 10 genes that encode tandem copies of this repeat, which is also found in other species. PSIPRED predicts with high confidence that each 40-residue repeats contains four beta strands. This model overlaps somewhat with the NHL repeat (Pfam pfam01436) and also shows sequence similarity to the WD domain, G-beta repeat (Pfam pfam00400).
Probab=84.98 E-value=4.7 Score=22.16 Aligned_cols=29 Identities=7% Similarity=0.128 Sum_probs=21.0
Q ss_pred cCCCEEEEe---cCcEEEEECCCCceeEEeec
Q 036605 125 CEEKIFALA---SSEVRILSLENGEEVLKFSD 153 (340)
Q Consensus 125 ~~~~~l~~~---~~~i~i~d~~~~~~~~~~~~ 153 (340)
|+++.|+++ ++.|.++|..+++.+..+..
T Consensus 1 pd~~~lyv~~~~~~~v~~id~~~~~~~~~i~v 32 (42)
T TIGR02276 1 PDGTKLYVTNSGSNTVSVIDTATNKVIATIPV 32 (42)
T ss_pred CCCCEEEEEeCCCCEEEEEECCCCeEEEEEEC
Confidence 567777663 34499999998887777654
No 477
>PF01011 PQQ: PQQ enzyme repeat family.; InterPro: IPR002372 Pyrrolo-quinoline quinone (PQQ) is a redox coenzyme, which serves as a cofactor for a number of enzymes (quinoproteins) and particularly for some bacterial dehydrogenases [, ]. A number of bacterial quinoproteins belong to this family. Enzymes in this group have repeats of a beta propeller.; PDB: 1H4I_C 1H4J_E 1W6S_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A 1G72_A ....
Probab=84.80 E-value=3.2 Score=22.62 Aligned_cols=27 Identities=19% Similarity=0.393 Sum_probs=23.0
Q ss_pred EEEEEeCCCcEEEEeCCCCeEEEEeec
Q 036605 87 SLHVVGTNGMASEMKSEMGEVIREFKA 113 (340)
Q Consensus 87 ~l~s~~~dg~i~~wd~~~~~~~~~~~~ 113 (340)
.++.++.+|.|.-.|..+|+.+..++.
T Consensus 2 ~v~~~~~~g~l~AlD~~TG~~~W~~~~ 28 (38)
T PF01011_consen 2 RVYVGTPDGYLYALDAKTGKVLWKFQT 28 (38)
T ss_dssp EEEEETTTSEEEEEETTTTSEEEEEES
T ss_pred EEEEeCCCCEEEEEECCCCCEEEeeeC
Confidence 467778999999999999999888764
No 478
>COG4590 ABC-type uncharacterized transport system, permease component [General function prediction only]
Probab=84.50 E-value=9.1 Score=34.07 Aligned_cols=155 Identities=18% Similarity=0.183 Sum_probs=84.0
Q ss_pred CCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeE-EEecCCCCC----CeE-EEEEecCCCEEEEEe
Q 036605 19 EPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMK-WKSTGRHPG----GLA-GLAFAKKGRSLHVVG 92 (340)
Q Consensus 19 ~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~-~~~~~~h~~----~v~-~v~~~~~~~~l~s~~ 92 (340)
..-+.|..+-..|||+ .|.+-+. .++.++++.+.... .++....++ .|+ .+..-..|..|+.++
T Consensus 218 ~~~~~v~qllL~Pdg~---------~LYv~~g-~~~~v~~L~~r~l~~rkl~~dspg~~~~~Vte~l~lL~Gg~SLLv~~ 287 (733)
T COG4590 218 VPFSDVSQLLLTPDGK---------TLYVRTG-SELVVALLDKRSLQIRKLVDDSPGDSRHQVTEQLYLLSGGFSLLVVH 287 (733)
T ss_pred CCccchHhhEECCCCC---------EEEEecC-CeEEEEeecccccchhhhhhcCCCchHHHHHHHHHHHhCceeEEEEc
Confidence 4456788888899998 6666554 67888888765422 122110122 122 122223466788889
Q ss_pred CCCcEEEE-eCCCCe-----EEEEeecCCCCeeEEEEccCCCEEEE--ecCcEEEEECCCCceeEEeecCCCCeEEEEEC
Q 036605 93 TNGMASEM-KSEMGE-----VIREFKASEKPISSSAFLCEEKIFAL--ASSEVRILSLENGEEVLKFSDDVGPLQYVSAS 164 (340)
Q Consensus 93 ~dg~i~~w-d~~~~~-----~~~~~~~~~~~i~~l~~~~~~~~l~~--~~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s 164 (340)
.||.|.-| |.+.+. .++.++-...++..+.-....+-+++ -.+++.++.....+.+ -+..-...+..+.+|
T Consensus 288 ~dG~vsQWFdvr~~~~p~l~h~R~f~l~pa~~~~l~pe~~rkgF~~l~~~G~L~~f~st~~~~l-L~~~~~~~~~~~~~S 366 (733)
T COG4590 288 EDGLVSQWFDVRRDGQPHLNHIRNFKLAPAEVQFLLPETNRKGFYSLYRNGTLQSFYSTSEKLL-LFERAYQAPQLVAMS 366 (733)
T ss_pred CCCceeeeeeeecCCCCcceeeeccccCcccceeeccccccceEEEEcCCCceeeeecccCcce-ehhhhhcCcceeeeC
Confidence 99999877 443221 12223333333333332222233333 2333444443322222 122222356778999
Q ss_pred CCCCEEEEEEcCCCeEEEEEcc
Q 036605 165 DGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 165 ~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
|.+.++++ -. .|.++++.++
T Consensus 367 p~~~~Ll~-e~-~gki~~~~l~ 386 (733)
T COG4590 367 PNQAYLLS-ED-QGKIRLAQLE 386 (733)
T ss_pred cccchhee-ec-CCceEEEEec
Confidence 99999988 33 6899999983
No 479
>PF14781 BBS2_N: Ciliary BBSome complex subunit 2, N-terminal
Probab=84.38 E-value=14 Score=27.03 Aligned_cols=103 Identities=13% Similarity=0.106 Sum_probs=61.0
Q ss_pred EEEecCCCEEEEEeCCCcEEEEeCCCCe--------EEEEeecCCCCeeEEEEcc-----CCCEEEEecCc-EEEEECCC
Q 036605 79 LAFAKKGRSLHVVGTNGMASEMKSEMGE--------VIREFKASEKPISSSAFLC-----EEKIFALASSE-VRILSLEN 144 (340)
Q Consensus 79 v~~~~~~~~l~s~~~dg~i~~wd~~~~~--------~~~~~~~~~~~i~~l~~~~-----~~~~l~~~~~~-i~i~d~~~ 144 (340)
-.|......|+.++.-|+|.++++.... .+..+. -...|++|+-.+ +...|+.++.+ +..||...
T Consensus 4 GkfDG~~pcL~~aT~~gKV~IH~ph~~~~~~~~~~~~i~~LN-in~~italaaG~l~~~~~~D~LliGt~t~llaYDV~~ 82 (136)
T PF14781_consen 4 GKFDGVHPCLACATTGGKVFIHNPHERGQRTGRQDSDISFLN-INQEITALAAGRLKPDDGRDCLLIGTQTSLLAYDVEN 82 (136)
T ss_pred EEeCCCceeEEEEecCCEEEEECCCccccccccccCceeEEE-CCCceEEEEEEecCCCCCcCEEEEeccceEEEEEccc
Confidence 3455455567777888889998876432 223333 234567776544 34566666655 99999988
Q ss_pred CceeEEeecCCCCeEEEEE---CC-CCCEEEEEEcCCCeEEEEEc
Q 036605 145 GEEVLKFSDDVGPLQYVSA---SD-GAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 145 ~~~~~~~~~~~~~v~~~~~---s~-~~~~l~s~~~~d~~i~iwd~ 185 (340)
...+.- +.-+..+.++.+ .. +...++. +. ...|.-||.
T Consensus 83 N~d~Fy-ke~~DGvn~i~~g~~~~~~~~l~iv-GG-ncsi~Gfd~ 124 (136)
T PF14781_consen 83 NSDLFY-KEVPDGVNAIVIGKLGDIPSPLVIV-GG-NCSIQGFDY 124 (136)
T ss_pred Cchhhh-hhCccceeEEEEEecCCCCCcEEEE-Cc-eEEEEEeCC
Confidence 755422 223356777766 22 3445555 33 467777765
No 480
>TIGR03606 non_repeat_PQQ dehydrogenase, PQQ-dependent, s-GDH family. PQQ, or pyrroloquinoline-quinone, serves as a cofactor for a number of sugar and alcohol dehydrogenases in a limited number of bacterial species. Most characterized PQQ-dependent enzymes have multiple repeats of a sequence region described by pfam01011 (PQQ enzyme repeat), but this protein family in unusual in lacking that repeat. Below the noise cutoff are related proteins mostly from species that lack PQQ biosynthesis.
Probab=84.35 E-value=32 Score=31.24 Aligned_cols=103 Identities=13% Similarity=0.035 Sum_probs=59.5
Q ss_pred CCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEE--EEe----e-cCCCCeeEEEEccCC------CEEEEe------
Q 036605 73 PGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVI--REF----K-ASEKPISSSAFLCEE------KIFALA------ 133 (340)
Q Consensus 73 ~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~--~~~----~-~~~~~i~~l~~~~~~------~~l~~~------ 133 (340)
-..-+.|+|.||++.|++--..|.|++++..++... ..+ . ........|+++|+- .+|+..
T Consensus 29 L~~Pw~maflPDG~llVtER~~G~I~~v~~~~~~~~~~~~l~~v~~~~ge~GLlglal~PdF~~~~~n~~lYvsyt~~~~ 108 (454)
T TIGR03606 29 LNKPWALLWGPDNQLWVTERATGKILRVNPETGEVKVVFTLPEIVNDAQHNGLLGLALHPDFMQEKGNPYVYISYTYKNG 108 (454)
T ss_pred CCCceEEEEcCCCeEEEEEecCCEEEEEeCCCCceeeeecCCceeccCCCCceeeEEECCCccccCCCcEEEEEEeccCC
Confidence 345689999999977776444699999986655322 111 1 135678899999885 233321
Q ss_pred c-----C-cEEEEECCCC--ce---eEEeecC----CCCeEEEEECCCCCEEEEEEc
Q 036605 134 S-----S-EVRILSLENG--EE---VLKFSDD----VGPLQYVSASDGAKIIITAGY 175 (340)
Q Consensus 134 ~-----~-~i~i~d~~~~--~~---~~~~~~~----~~~v~~~~~s~~~~~l~s~~~ 175 (340)
+ . .|.-|.+... .. ...+... ...-..|.|.|||..+++.++
T Consensus 109 ~~~~~~~~~I~R~~l~~~~~~l~~~~~Il~~lP~~~~H~GgrI~FgPDG~LYVs~GD 165 (454)
T TIGR03606 109 DKELPNHTKIVRYTYDKSTQTLEKPVDLLAGLPAGNDHNGGRLVFGPDGKIYYTIGE 165 (454)
T ss_pred CCCccCCcEEEEEEecCCCCccccceEEEecCCCCCCcCCceEEECCCCcEEEEECC
Confidence 1 1 2544554321 00 1112111 122457889999987777665
No 481
>PF13570 PQQ_3: PQQ-like domain; PDB: 3HXJ_B 3Q54_A.
Probab=84.11 E-value=3.9 Score=22.48 Aligned_cols=21 Identities=14% Similarity=0.158 Sum_probs=16.2
Q ss_pred CCCEEEEEeCCCcEEEEeCCC
Q 036605 84 KGRSLHVVGTNGMASEMKSEM 104 (340)
Q Consensus 84 ~~~~l~s~~~dg~i~~wd~~~ 104 (340)
.+..++.++.||.+..+|.++
T Consensus 20 ~~g~vyv~~~dg~l~ald~~t 40 (40)
T PF13570_consen 20 AGGRVYVGTGDGNLYALDAAT 40 (40)
T ss_dssp CTSEEEEE-TTSEEEEEETT-
T ss_pred ECCEEEEEcCCCEEEEEeCCC
Confidence 366899999999999999764
No 482
>PF03022 MRJP: Major royal jelly protein; InterPro: IPR003534 The major royal jelly proteins (MRJPs) comprise 12.5% of the mass, and 82-90% of the protein content [], of honeybee (Apis mellifera) royal jelly. Royal jelly is a substance secreted by the cephalic glands of nurse bees [] and it is used to trigger development of a queen bee from a bee larva. The biological function of the MRJPs is unknown, but they are believed to play a major role in nutrition due to their high essential amino acid content []. Two royal jelly proteins, MRJP3 and MRJP5, contain a tandem repeat that results from a high genetic variablility. This polymorphism may be useful for genotyping individual bees [].; PDB: 3Q6P_B 3Q6K_A 3Q6T_A 2QE8_B.
Probab=83.74 E-value=26 Score=29.68 Aligned_cols=169 Identities=9% Similarity=0.109 Sum_probs=83.4
Q ss_pred CccCCCCceeeeeeCCC--CCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCC-------
Q 036605 1 IWSTNDGSLLAEWKQPD--GEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGR------- 71 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~--~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~------- 71 (340)
+||+.++++++.|.-+. ....+....+.+..... .+ +. .-..++-+..+-|.+||+.+++.-+.+...
T Consensus 38 ~~Dl~t~~li~~~~~p~~~~~~~s~lndl~VD~~~~-~~-~~-~~aYItD~~~~glIV~dl~~~~s~Rv~~~~~~~~p~~ 114 (287)
T PF03022_consen 38 AFDLKTNQLIRRYPFPPDIAPPDSFLNDLVVDVRDG-NC-DD-GFAYITDSGGPGLIVYDLATGKSWRVLHNSFSPDPDA 114 (287)
T ss_dssp EEETTTTCEEEEEE--CCCS-TCGGEEEEEEECTTT-TS--S-EEEEEEETTTCEEEEEETTTTEEEEEETCGCTTS-SS
T ss_pred EEECCCCcEEEEEECChHHcccccccceEEEEccCC-CC-cc-eEEEEeCCCcCcEEEEEccCCcEEEEecCCcceeccc
Confidence 48999999887665431 12235566777754210 00 00 013344445568999999998754433220
Q ss_pred -----------CCCCeEEEEEec---CCCEEEEEeCCC-cEEEEeC---CCCe---------EEEEeecCCCCeeEEEEc
Q 036605 72 -----------HPGGLAGLAFAK---KGRSLHVVGTNG-MASEMKS---EMGE---------VIREFKASEKPISSSAFL 124 (340)
Q Consensus 72 -----------h~~~v~~v~~~~---~~~~l~s~~~dg-~i~~wd~---~~~~---------~~~~~~~~~~~i~~l~~~ 124 (340)
..+.+..++.+| +++.|+...-.+ .++-... .+.. .+..+-........++++
T Consensus 115 ~~~~i~g~~~~~~dg~~gial~~~~~d~r~LYf~~lss~~ly~v~T~~L~~~~~~~~~~~~~~v~~lG~k~~~s~g~~~D 194 (287)
T PF03022_consen 115 GPFTIGGESFQWPDGIFGIALSPISPDGRWLYFHPLSSRKLYRVPTSVLRDPSLSDAQALASQVQDLGDKGSQSDGMAID 194 (287)
T ss_dssp EEEEETTEEEEETTSEEEEEE-TTSTTS-EEEEEETT-SEEEEEEHHHHCSTT--HHH-HHHT-EEEEE---SECEEEEE
T ss_pred cceeccCceEecCCCccccccCCCCCCccEEEEEeCCCCcEEEEEHHHhhCccccccccccccceeccccCCCCceEEEC
Confidence 112355666655 556666655432 2222211 1110 111121111345678888
Q ss_pred cCCCEEEE--ecCcEEEEECCCCc---eeEEe-ecC--CCCeEEEEECC--CCCEEEE
Q 036605 125 CEEKIFAL--ASSEVRILSLENGE---EVLKF-SDD--VGPLQYVSASD--GAKIIIT 172 (340)
Q Consensus 125 ~~~~~l~~--~~~~i~i~d~~~~~---~~~~~-~~~--~~~v~~~~~s~--~~~~l~s 172 (340)
++|.++++ ....|..|+..+.- ....+ ... -..+..+.+.+ +|...+.
T Consensus 195 ~~G~ly~~~~~~~aI~~w~~~~~~~~~~~~~l~~d~~~l~~pd~~~i~~~~~g~L~v~ 252 (287)
T PF03022_consen 195 PNGNLYFTDVEQNAIGCWDPDGPYTPENFEILAQDPRTLQWPDGLKIDPEGDGYLWVL 252 (287)
T ss_dssp TTTEEEEEECCCTEEEEEETTTSB-GCCEEEEEE-CC-GSSEEEEEE-T--TS-EEEE
T ss_pred CCCcEEEecCCCCeEEEEeCCCCcCccchheeEEcCceeeccceeeeccccCceEEEE
Confidence 98888877 33449999987621 11222 222 35778888888 6644443
No 483
>PF08728 CRT10: CRT10; InterPro: IPR014839 CRT10 is a transcriptional regulator of ribonucleotide reductase (RNR) genes []. RNR catalyses the rate limiting step in dNTP synthesis. Mutations in CRT10 have been shown to enhance hydroxyurea resistance [].
Probab=83.51 E-value=27 Score=33.50 Aligned_cols=139 Identities=11% Similarity=0.084 Sum_probs=80.4
Q ss_pred EEEEEcCCCcEEEEEccCCeeEE------Eec----------C-----CCCCCeEEEEEec--CCCEEEEEeCCCcEEEE
Q 036605 44 LLALGTSNGDILAVDVLTGEMKW------KST----------G-----RHPGGLAGLAFAK--KGRSLHVVGTNGMASEM 100 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~------~~~----------~-----~h~~~v~~v~~~~--~~~~l~s~~~dg~i~~w 100 (340)
+|+++. .+.|.||+...-.... .+. . ..+..|+.|.... +...|+.|.+||.|.+|
T Consensus 51 ~LFiA~-~s~I~Vy~~d~l~~~p~~~p~~~~~t~p~~~~~~D~~~s~~p~PHtIN~i~v~~lg~~EVLl~c~DdG~V~~Y 129 (717)
T PF08728_consen 51 LLFIAY-QSEIYVYDPDGLTQLPSRKPCLRFDTKPEFTSTPDRLISTWPFPHTINFIKVGDLGGEEVLLLCTDDGDVLAY 129 (717)
T ss_pred EEEEEE-CCEEEEEecCCcccccccccccccccCccccccccccccCCCCCceeeEEEecccCCeeEEEEEecCCeEEEE
Confidence 566654 7789999976432211 110 0 0112355554432 34578889999999999
Q ss_pred eCCC-------C----e---------EEEEeecCCCCeeEEEEc--cCCCEEEEecCc--EEEE--ECCCCcee-EEeec
Q 036605 101 KSEM-------G----E---------VIREFKASEKPISSSAFL--CEEKIFALASSE--VRIL--SLENGEEV-LKFSD 153 (340)
Q Consensus 101 d~~~-------~----~---------~~~~~~~~~~~i~~l~~~--~~~~~l~~~~~~--i~i~--d~~~~~~~-~~~~~ 153 (340)
..++ . + +...+. -....++++++ ...+++|++++. |.|| .+...+.. ..-..
T Consensus 130 yt~~I~~~i~~~~~~~~~~~~r~~i~P~f~~~-v~~SaWGLdIh~~~~~rlIAVSsNs~~VTVFaf~l~~~r~~~~~s~~ 208 (717)
T PF08728_consen 130 YTETIIEAIERFSEDNDSGFSRLKIKPFFHLR-VGASAWGLDIHDYKKSRLIAVSSNSQEVTVFAFALVDERFYHVPSHQ 208 (717)
T ss_pred EHHHHHHHHHhhccccccccccccCCCCeEee-cCCceeEEEEEecCcceEEEEecCCceEEEEEEeccccccccccccc
Confidence 6421 0 0 111122 23467899998 778888887766 4444 44322211 11113
Q ss_pred CCCCeEEEEECCC-----CC-EEEEEEcCCCeEEEEEc
Q 036605 154 DVGPLQYVSASDG-----AK-IIITAGYGEKHLQVWRC 185 (340)
Q Consensus 154 ~~~~v~~~~~s~~-----~~-~l~s~~~~d~~i~iwd~ 185 (340)
+...|.++.|-++ |. .+++++- .|.+.+|++
T Consensus 209 ~~hNIP~VSFl~~~~d~~G~v~v~a~dI-~G~v~~~~I 245 (717)
T PF08728_consen 209 HSHNIPNVSFLDDDLDPNGHVKVVATDI-SGEVWTFKI 245 (717)
T ss_pred cccCCCeeEeecCCCCCccceEEEEEec-cCcEEEEEE
Confidence 5567889999554 32 5555555 899999888
No 484
>KOG1896 consensus mRNA cleavage and polyadenylation factor II complex, subunit CFT1 (CPSF subunit) [RNA processing and modification]
Probab=83.18 E-value=57 Score=33.21 Aligned_cols=140 Identities=12% Similarity=0.154 Sum_probs=70.4
Q ss_pred EEEEEcC---------CCcEEEEEccC-----Ce------eEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCC
Q 036605 44 LLALGTS---------NGDILAVDVLT-----GE------MKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSE 103 (340)
Q Consensus 44 ~l~~g~~---------dg~i~i~d~~~-----~~------~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~ 103 (340)
|||+|+. .|.++|||+-. |+ ....+....+|.|..++=- +| +|++ +....|.+|+++
T Consensus 1048 ylavGT~~~~gEDv~~RGr~hi~diIeVVPepgkP~t~~KlKel~~eE~KGtVsavceV-~G-~l~~-~~GqKI~v~~l~ 1124 (1366)
T KOG1896|consen 1048 YLAVGTAFIQGEDVPARGRIHIFDIIEVVPEPGKPFTKNKLKELYIEEQKGTVSAVCEV-RG-HLLS-SQGQKIIVRKLD 1124 (1366)
T ss_pred eEEEEEeecccccccCcccEEEEEEEEecCCCCCCcccceeeeeehhhcccceEEEEEe-cc-EEEE-ccCcEEEEEEec
Confidence 8998864 38999999632 22 2222233467788887743 45 4444 344589999984
Q ss_pred CCeEEEEeecCCCCeeEEEEccCCCEEEEecCc--EEEEECCCC-ceeEEee--cCCCCeEEEEECCCCC--EEEEEEcC
Q 036605 104 MGEVIREFKASEKPISSSAFLCEEKIFALASSE--VRILSLENG-EEVLKFS--DDVGPLQYVSASDGAK--IIITAGYG 176 (340)
Q Consensus 104 ~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~-~~~~~~~--~~~~~v~~~~~s~~~~--~l~s~~~~ 176 (340)
....+.-...-.-+++-....--.++++.+|-- |.+.-.... ..+..+. ...-.+.++.|.-+|. +++++..
T Consensus 1125 r~~~ligVaFiD~~~yv~s~~~vknlIl~gDV~ksisfl~fqeep~rlsL~srd~~~l~v~s~EFLVdg~~L~flvsDa- 1203 (1366)
T KOG1896|consen 1125 RDSELIGVAFIDLPLYVHSMKVVKNLILAGDVMKSISFLGFQEEPYRLSLLSRDFEPLNVYSTEFLVDGSNLSFLVSDA- 1203 (1366)
T ss_pred cCCcceeeEEeccceeEEehhhhhhheehhhhhhceEEEEEccCceEEEEeecCCchhhceeeeeEEcCCeeEEEEEcC-
Confidence 333222111112222222222233444444322 333322221 1121121 1123466777755544 4555444
Q ss_pred CCeEEEEEccC
Q 036605 177 EKHLQVWRCDI 187 (340)
Q Consensus 177 d~~i~iwd~~~ 187 (340)
++.|++|-...
T Consensus 1204 ~rNi~vy~Y~P 1214 (1366)
T KOG1896|consen 1204 DRNIHVYMYAP 1214 (1366)
T ss_pred CCcEEEEEeCC
Confidence 99999998743
No 485
>KOG0918 consensus Selenium-binding protein [Inorganic ion transport and metabolism]
Probab=82.83 E-value=32 Score=30.21 Aligned_cols=98 Identities=12% Similarity=0.047 Sum_probs=62.2
Q ss_pred CccCCCCceeeeeeCCCCCCCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCee----E----------E
Q 036605 1 IWSTNDGSLLAEWKQPDGEPVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEM----K----------W 66 (340)
Q Consensus 1 vwd~~~g~~~~~~~~~~~~~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~----~----------~ 66 (340)
+|...++++.+++... .....+.++.|-.+..+ +..+.-++..++.++++.....+. + +
T Consensus 233 vy~w~~~~~~QtidL~--~~gllpleiRfLh~p~~-----~~~fvg~Al~s~i~~~~k~~~~tws~~~visvp~~kv~~w 305 (476)
T KOG0918|consen 233 VYQWSPGELKQTIDLG--DTGLLPLEIRFLHNPSK-----ATGFVGCALSSNIFRFFKNSDDTWSAEVVISVPPLKVENW 305 (476)
T ss_pred EEecCCccceeEEecC--CCCcceEEeeeccCCCc-----ccceeeeeccCCceeeeeccccccceeEEEecCccccccc
Confidence 5777788888877754 33567788888544320 111455555666677665443221 1 1
Q ss_pred EecCCCCCCeEEEEEecCCCEEEEEeC-CCcEEEEeCCCCe
Q 036605 67 KSTGRHPGGLAGLAFAKKGRSLHVVGT-NGMASEMKSEMGE 106 (340)
Q Consensus 67 ~~~~~h~~~v~~v~~~~~~~~l~s~~~-dg~i~~wd~~~~~ 106 (340)
.+.. -++-|+.+-.|-|.++|+.+.. -|.|+-||+..-.
T Consensus 306 ~~~e-MP~LITDilISmDDRFLYvs~WLHGDirQYdIsDP~ 345 (476)
T KOG0918|consen 306 ILPE-MPGLITDILISLDDRFLYVSNWLHGDIRQYDISDPK 345 (476)
T ss_pred cCcc-cchhhheeEEeecCcEEEEEeeeecceeeeccCCCC
Confidence 1122 4567899999999999988764 5899999987644
No 486
>COG3823 Glutamine cyclotransferase [Posttranslational modification, protein turnover, chaperones]
Probab=82.74 E-value=22 Score=28.25 Aligned_cols=119 Identities=11% Similarity=0.050 Sum_probs=63.3
Q ss_pred CCCEEEEe----cCcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEcCCCeEEEEEccCCCCCccCCceeeec
Q 036605 126 EEKIFALA----SSEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGYGEKHLQVWRCDISSKTVNKGPALSMR 201 (340)
Q Consensus 126 ~~~~l~~~----~~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~~~~~~~~~~~~~~~~~ 201 (340)
+|.++.+. ...|++||+.+++.+.+-.-....+..--...-+.++..-...++.-.++|. .+.+....+.+ +
T Consensus 55 ~g~i~esTG~yg~S~ir~~~L~~gq~~~s~~l~~~~~FgEGit~~gd~~y~LTw~egvaf~~d~--~t~~~lg~~~y--~ 130 (262)
T COG3823 55 DGHILESTGLYGFSKIRVSDLTTGQEIFSEKLAPDTVFGEGITKLGDYFYQLTWKEGVAFKYDA--DTLEELGRFSY--E 130 (262)
T ss_pred CCEEEEeccccccceeEEEeccCceEEEEeecCCccccccceeeccceEEEEEeccceeEEECh--HHhhhhccccc--C
Confidence 45555553 3339999999998876543321111111111123344443455888888887 45444444432 2
Q ss_pred CCCeeeeeecCCCCCCCCEEEEEeCCCcEEEEECCCCCccCCCCCceEEEeeccccccc
Q 036605 202 HSPVAIDCKNSPNGEDGTVILAVAESGVAYSWDLKTVSQDEKTNPAKITVKLKKADADQ 260 (340)
Q Consensus 202 ~~~~~~~~~~~~~~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p~~i~~~~~~~~~~~ 260 (340)
...+ .+ ..|+..|+.+.....+++-|.++-.... ++++..++.|+..
T Consensus 131 GeGW--gL-----t~d~~~LimsdGsatL~frdP~tfa~~~-----~v~VT~~g~pv~~ 177 (262)
T COG3823 131 GEGW--GL-----TSDDKNLIMSDGSATLQFRDPKTFAELD-----TVQVTDDGVPVSK 177 (262)
T ss_pred Ccce--ee-----ecCCcceEeeCCceEEEecCHHHhhhcc-----eEEEEECCeeccc
Confidence 2222 22 3455556666666667766766654444 5667666655444
No 487
>COG3292 Predicted periplasmic ligand-binding sensor domain [Signal transduction mechanisms]
Probab=82.47 E-value=32 Score=31.83 Aligned_cols=100 Identities=13% Similarity=0.173 Sum_probs=61.2
Q ss_pred EEEEcCCCcEEEEEccC-CeeEEEecCCCCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCeEEEEee--c---CCCCe
Q 036605 45 LALGTSNGDILAVDVLT-GEMKWKSTGRHPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGEVIREFK--A---SEKPI 118 (340)
Q Consensus 45 l~~g~~dg~i~i~d~~~-~~~~~~~~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~~~~--~---~~~~i 118 (340)
+-.|+...-+..|+.++ +...-...+...++|..+-=.|+++ |..|+.+|.++. +.+.++....+. . ..+.+
T Consensus 389 lWlgs~q~GLsrl~n~n~~avlde~agl~ss~V~aived~dns-LWIGTs~Glvk~-~pe~~~v~n~ln~~~~~l~~s~~ 466 (671)
T COG3292 389 LWLGSMQNGLSRLDNKNEWAVLDEDAGLPSSEVSAIVEDPDNS-LWIGTSGGLVKR-DPESGRVLNLLNPGSHGLDGSRV 466 (671)
T ss_pred EEEEecccchhhhccCCcccccccccCCcccceeeeeecCCCC-EEEeccCCeEec-CccccchhcccccccCcCCcchh
Confidence 55555553345555554 3333333333456788888888887 777888876654 445544433322 1 12346
Q ss_pred eEEEEccCCCEEEEecCcEEEEECCCCc
Q 036605 119 SSSAFLCEEKIFALASSEVRILSLENGE 146 (340)
Q Consensus 119 ~~l~~~~~~~~l~~~~~~i~i~d~~~~~ 146 (340)
..+.+.|+|+.-+..+..|..|+.+...
T Consensus 467 ~~lg~~~~g~Lw~a~g~gva~~~sq~~~ 494 (671)
T COG3292 467 EQLGLGPDGRLWLAAGSGVAAWESQRRM 494 (671)
T ss_pred hhhccCCCCceEEEecceeeeeccccce
Confidence 7788999999887777678888876543
No 488
>PF13449 Phytase-like: Esterase-like activity of phytase
Probab=82.39 E-value=32 Score=29.75 Aligned_cols=155 Identities=13% Similarity=0.133 Sum_probs=89.3
Q ss_pred CCCeEEEEeeccccccccccCceEEEEEcCCCc------EEEEEccC--C--ee-----EEEecCCCCC--------CeE
Q 036605 21 VVSYSCLACGFVGKKRRKERGTLLLALGTSNGD------ILAVDVLT--G--EM-----KWKSTGRHPG--------GLA 77 (340)
Q Consensus 21 ~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~------i~i~d~~~--~--~~-----~~~~~~~h~~--------~v~ 77 (340)
-+..+.|.+.|++. .+++-+.+|. ++.+++.. + .. ...+.. -.+ ..-
T Consensus 19 ~GGlSgl~~~~~~~---------~~~avSD~g~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~L~~-~~G~~~~~~~~D~E 88 (326)
T PF13449_consen 19 FGGLSGLDYDPDDG---------RFYAVSDRGPNKGPPRFYTFRIDYDQGGIGGVTILDMIPLRD-PDGQPFPKNGLDPE 88 (326)
T ss_pred cCcEeeEEEeCCCC---------EEEEEECCCCCCCCCcEEEEEeeccCCCccceEeccceeccC-CCCCcCCcCCCChh
Confidence 35678899986554 3566667777 66555443 1 00 111121 111 234
Q ss_pred EEEEecCCCEEEEEeCC------CcEEEEeCCCCeEEEEee---------------cCCCCeeEEEEccCCCEEEE----
Q 036605 78 GLAFAKKGRSLHVVGTN------GMASEMKSEMGEVIREFK---------------ASEKPISSSAFLCEEKIFAL---- 132 (340)
Q Consensus 78 ~v~~~~~~~~l~s~~~d------g~i~~wd~~~~~~~~~~~---------------~~~~~i~~l~~~~~~~~l~~---- 132 (340)
+|++.+++.++++.-.+ ..|..++.. |+....+. .......+|+++|+|+.|++
T Consensus 89 gi~~~~~g~~~is~E~~~~~~~~p~I~~~~~~-G~~~~~~~vP~~~~~~~~~~~~~~~N~G~E~la~~~dG~~l~~~~E~ 167 (326)
T PF13449_consen 89 GIAVPPDGSFWISSEGGRTGGIPPRIRRFDLD-GRVIRRFPVPAAFLPDANGTSGRRNNRGFEGLAVSPDGRTLFAAMES 167 (326)
T ss_pred HeEEecCCCEEEEeCCccCCCCCCEEEEECCC-CcccceEccccccccccCccccccCCCCeEEEEECCCCCEEEEEECc
Confidence 77887788888876667 789999876 66544431 12346789999999995533
Q ss_pred ---ecC--c---------EEEEECCC-CceeEEe--ec-------CCCCeEEEEECCCCCEEEEEEc----CCCeEEEEE
Q 036605 133 ---ASS--E---------VRILSLEN-GEEVLKF--SD-------DVGPLQYVSASDGAKIIITAGY----GEKHLQVWR 184 (340)
Q Consensus 133 ---~~~--~---------i~i~d~~~-~~~~~~~--~~-------~~~~v~~~~~s~~~~~l~s~~~----~d~~i~iwd 184 (340)
.++ . |..||..+ +.....+ .. ....+..+.+-+++++++.--. ....++|+.
T Consensus 168 ~l~~d~~~~~~~~~~~~ri~~~d~~~~~~~~~~~~y~ld~~~~~~~~~~isd~~al~d~~lLvLER~~~~~~~~~~ri~~ 247 (326)
T PF13449_consen 168 PLKQDGPRANPDNGSPLRILRYDPKTPGEPVAEYAYPLDPPPTAPGDNGISDIAALPDGRLLVLERDFSPGTGNYKRIYR 247 (326)
T ss_pred cccCCCcccccccCceEEEEEecCCCCCccceEEEEeCCccccccCCCCceeEEEECCCcEEEEEccCCCCccceEEEEE
Confidence 111 1 44455554 3222222 21 3467888888888886664111 134566666
Q ss_pred cc
Q 036605 185 CD 186 (340)
Q Consensus 185 ~~ 186 (340)
++
T Consensus 248 v~ 249 (326)
T PF13449_consen 248 VD 249 (326)
T ss_pred EE
Confidence 64
No 489
>PF05935 Arylsulfotrans: Arylsulfotransferase (ASST); InterPro: IPR010262 This family consists of several bacterial arylsulphotransferase proteins. Arylsulphotransferase (ASST) transfers a sulphate group from phenolic sulphate esters to a phenolic acceptor substrate [].; PDB: 3ETT_B 3ELQ_A 3ETS_A.
Probab=81.50 E-value=44 Score=30.74 Aligned_cols=114 Identities=17% Similarity=0.203 Sum_probs=59.7
Q ss_pred EEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCC---CCeEEEEEecCCCEEEEEeC----------
Q 036605 27 LACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHP---GGLAGLAFAKKGRSLHVVGT---------- 93 (340)
Q Consensus 27 l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~---~~v~~v~~~~~~~~l~s~~~---------- 93 (340)
+...++|. +++... ..+..+|+. |+.++.+.- -. ..=..+.+.|+|+.|+.+..
T Consensus 153 ~~~l~nG~---------ll~~~~--~~~~e~D~~-G~v~~~~~l-~~~~~~~HHD~~~l~nGn~L~l~~~~~~~~~~~~~ 219 (477)
T PF05935_consen 153 FKQLPNGN---------LLIGSG--NRLYEIDLL-GKVIWEYDL-PGGYYDFHHDIDELPNGNLLILASETKYVDEDKDV 219 (477)
T ss_dssp EEE-TTS----------EEEEEB--TEEEEE-TT---EEEEEE---TTEE-B-S-EEE-TTS-EEEEEEETTEE-TS-EE
T ss_pred eeEcCCCC---------EEEecC--CceEEEcCC-CCEEEeeec-CCcccccccccEECCCCCEEEEEeecccccCCCCc
Confidence 55567777 555443 778888875 555554432 11 11246677889998887771
Q ss_pred ---CCcEEEEeCCCCeEEEEeec--C----C---------------------CCeeEEEEcc-CCCEEEEecCc--EEEE
Q 036605 94 ---NGMASEMKSEMGEVIREFKA--S----E---------------------KPISSSAFLC-EEKIFALASSE--VRIL 140 (340)
Q Consensus 94 ---dg~i~~wd~~~~~~~~~~~~--~----~---------------------~~i~~l~~~~-~~~~l~~~~~~--i~i~ 140 (340)
.-.|..+| .+|+.+..+.. | . .-+.++.+.+ ++.+++++-.. |...
T Consensus 220 ~~~~D~Ivevd-~tG~vv~~wd~~d~ld~~~~~~~~~~~~~~~~~~~~~~DW~H~Nsi~yd~~dd~iivSsR~~s~V~~I 298 (477)
T PF05935_consen 220 DTVEDVIVEVD-PTGEVVWEWDFFDHLDPYRDTVLKPYPYGDISGSGGGRDWLHINSIDYDPSDDSIIVSSRHQSAVIKI 298 (477)
T ss_dssp ---S-EEEEE--TTS-EEEEEEGGGTS-TT--TTGGT--SSSSS-SSTTSBS--EEEEEEETTTTEEEEEETTT-EEEEE
T ss_pred cEecCEEEEEC-CCCCEEEEEehHHhCCcccccccccccccccccCCCCCCccccCccEEeCCCCeEEEEcCcceEEEEE
Confidence 12466777 88888776431 1 0 1257888888 55555555444 8888
Q ss_pred ECCCCceeEEeecC
Q 036605 141 SLENGEEVLKFSDD 154 (340)
Q Consensus 141 d~~~~~~~~~~~~~ 154 (340)
|.++++....+..+
T Consensus 299 d~~t~~i~Wilg~~ 312 (477)
T PF05935_consen 299 DYRTGKIKWILGPP 312 (477)
T ss_dssp E-TTS-EEEEES-S
T ss_pred ECCCCcEEEEeCCC
Confidence 88888766555443
No 490
>PRK10115 protease 2; Provisional
Probab=81.31 E-value=55 Score=31.75 Aligned_cols=149 Identities=3% Similarity=-0.085 Sum_probs=75.0
Q ss_pred EEEEeeccccccccccCceEEEEEcCC------CcEEEEEccCC--eeEEEecCCCCCCeE-EEEEecCCCEEEEEeC--
Q 036605 25 SCLACGFVGKKRRKERGTLLLALGTSN------GDILAVDVLTG--EMKWKSTGRHPGGLA-GLAFAKKGRSLHVVGT-- 93 (340)
Q Consensus 25 ~~l~~sp~~~~~~~~~~~~~l~~g~~d------g~i~i~d~~~~--~~~~~~~~~h~~~v~-~v~~~~~~~~l~s~~~-- 93 (340)
..++|++|++ .|+....+ ..|+.+++.++ +....+.. ...... .+..+.++++++..+.
T Consensus 175 ~~~~w~~D~~---------~~~y~~~~~~~~~~~~v~~h~lgt~~~~d~lv~~e-~~~~~~~~~~~s~d~~~l~i~~~~~ 244 (686)
T PRK10115 175 PSFVWANDSW---------TFYYVRKHPVTLLPYQVWRHTIGTPASQDELVYEE-KDDTFYVSLHKTTSKHYVVIHLASA 244 (686)
T ss_pred eEEEEeeCCC---------EEEEEEecCCCCCCCEEEEEECCCChhHCeEEEee-CCCCEEEEEEEcCCCCEEEEEEECC
Confidence 4599999986 45544332 36788888877 33333433 222333 2233447776655433
Q ss_pred -CCcEEEEeC--CCCeEEEEeecCCCCeeEEEEccCCCEEEEecC---c--EEEEECCCCceeEEeecC-C-CCeEEEEE
Q 036605 94 -NGMASEMKS--EMGEVIREFKASEKPISSSAFLCEEKIFALASS---E--VRILSLENGEEVLKFSDD-V-GPLQYVSA 163 (340)
Q Consensus 94 -dg~i~~wd~--~~~~~~~~~~~~~~~i~~l~~~~~~~~l~~~~~---~--i~i~d~~~~~~~~~~~~~-~-~~v~~~~~ 163 (340)
++.+.+++. .++.....+.........+. +..+.+++..+. . |...++........+..+ . ..+..+.+
T Consensus 245 ~~~~~~l~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~ly~~tn~~~~~~~l~~~~~~~~~~~~~l~~~~~~~~i~~~~~ 323 (686)
T PRK10115 245 TTSEVLLLDAELADAEPFVFLPRRKDHEYSLD-HYQHRFYLRSNRHGKNFGLYRTRVRDEQQWEELIPPRENIMLEGFTL 323 (686)
T ss_pred ccccEEEEECcCCCCCceEEEECCCCCEEEEE-eCCCEEEEEEcCCCCCceEEEecCCCcccCeEEECCCCCCEEEEEEE
Confidence 357888884 33443223332223333332 323333333222 1 444455422222334344 2 36777777
Q ss_pred CCCCCEEEEEEcCCCeEEEEEcc
Q 036605 164 SDGAKIIITAGYGEKHLQVWRCD 186 (340)
Q Consensus 164 s~~~~~l~s~~~~d~~i~iwd~~ 186 (340)
. +.+|+.....++.-+++-++
T Consensus 324 ~--~~~l~~~~~~~g~~~l~~~~ 344 (686)
T PRK10115 324 F--TDWLVVEERQRGLTSLRQIN 344 (686)
T ss_pred E--CCEEEEEEEeCCEEEEEEEc
Confidence 6 33555555547777777664
No 491
>KOG1983 consensus Tomosyn and related SNARE-interacting proteins [Intracellular trafficking, secretion, and vesicular transport]
Probab=81.02 E-value=67 Score=32.62 Aligned_cols=32 Identities=22% Similarity=0.406 Sum_probs=25.2
Q ss_pred CCCCCEEEEEeCCCcEEEEECCCCCccCCCCC
Q 036605 215 GEDGTVILAVAESGVAYSWDLKTVSQDEKTNP 246 (340)
Q Consensus 215 ~~~~~~l~~~s~dg~i~vwd~~~~~~~~~~~p 246 (340)
..++..++++..||.+.+||...+......++
T Consensus 243 ~~~~~~~v~~h~Dgs~~fWd~s~g~~~~~~~~ 274 (993)
T KOG1983|consen 243 SRDGSHFVSYHTDGSYAFWDVSSGKLQIARNP 274 (993)
T ss_pred ccCCceEEEEEecCCEEeeecCCCceeecCcc
Confidence 46788999999999999999998655443333
No 492
>PF14269 Arylsulfotran_2: Arylsulfotransferase (ASST)
Probab=80.67 E-value=35 Score=29.10 Aligned_cols=134 Identities=14% Similarity=0.184 Sum_probs=0.0
Q ss_pred EcCCCcEEEEEccCCeeEEEecCCCC------------CCeEEEEEecCCCEEEE------------------EeCCCcE
Q 036605 48 GTSNGDILAVDVLTGEMKWKSTGRHP------------GGLAGLAFAKKGRSLHV------------------VGTNGMA 97 (340)
Q Consensus 48 g~~dg~i~i~d~~~~~~~~~~~~~h~------------~~v~~v~~~~~~~~l~s------------------~~~dg~i 97 (340)
|-..|.+.+.| ...+.++++.. .. .....+.+.++|..|++ --.|+.+
T Consensus 21 g~g~G~~~~lD-~~y~~i~~v~~-~~~~~~~~~~~~~~~d~He~~it~~gt~lvt~~~~~~~dls~~gg~~~g~i~d~~~ 98 (299)
T PF14269_consen 21 GYGYGSYVILD-SSYEVIWNVSA-GNDFGTPDGEPGSYADHHEFEITPDGTALVTAYNPTPADLSPVGGPEDGWILDDVF 98 (299)
T ss_pred ccccceEEEEC-CCCcEEEEEEC-CCcccccccccCccCCccceEEcCCCcEEEEEccceeccccccCcCCCccEeccee
Q ss_pred EEEeCCCCeEEEEeec---------------------------CCCCeeEEEEccCCCEEEEecCc--EEEEECCCCcee
Q 036605 98 SEMKSEMGEVIREFKA---------------------------SEKPISSSAFLCEEKIFALASSE--VRILSLENGEEV 148 (340)
Q Consensus 98 ~~wd~~~~~~~~~~~~---------------------------~~~~i~~l~~~~~~~~l~~~~~~--i~i~d~~~~~~~ 148 (340)
.-.|+.+++.+.++.. .---+.+|...++|.+|+++-.. |.+.|-++|+.+
T Consensus 99 ~EiDi~TgevlfeW~a~DH~~~~~~~~~~~~~~~~g~~~~~~~D~~HiNsV~~~~~G~yLiS~R~~~~i~~I~~~tG~I~ 178 (299)
T PF14269_consen 99 QEIDIETGEVLFEWSASDHVDPNDSYDSQDPLPGSGGSSSFPWDYFHINSVDKDDDGDYLISSRNTSTIYKIDPSTGKII 178 (299)
T ss_pred EEeccCCCCEEEEEEhhheecccccccccccccCCCcCCCCCCCccEeeeeeecCCccEEEEecccCEEEEEECCCCcEE
Q ss_pred EEeecCCCCeEE-----EEECCCCCEEEEEEcCCCeEEEEE
Q 036605 149 LKFSDDVGPLQY-----VSASDGAKIIITAGYGEKHLQVWR 184 (340)
Q Consensus 149 ~~~~~~~~~v~~-----~~~s~~~~~l~s~~~~d~~i~iwd 184 (340)
-.+.+....-.. .++-.+-+++-.+.. ++.|.+||
T Consensus 179 W~lgG~~~~df~~~~~~f~~QHdar~~~~~~~-~~~IslFD 218 (299)
T PF14269_consen 179 WRLGGKRNSDFTLPATNFSWQHDARFLNESND-DGTISLFD 218 (299)
T ss_pred EEeCCCCCCcccccCCcEeeccCCEEeccCCC-CCEEEEEc
No 493
>TIGR02171 Fb_sc_TIGR02171 Fibrobacter succinogenes paralogous family TIGR02171. This model describes a paralogous family of the rumen bacterium Fibrobacter succinogenes. Eleven members are found in Fibrobacter succinogenes S85, averaging over 900 amino acids in length. More than half are predicted lipoproteins. The function is unknown.
Probab=80.20 E-value=18 Score=35.50 Aligned_cols=87 Identities=10% Similarity=0.106 Sum_probs=57.0
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEE-ecCCCCCCeEEEEEecCCCEEEE-EeCCC-----cEEEEeCCCC-eEEEEeecCC
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWK-STGRHPGGLAGLAFAKKGRSLHV-VGTNG-----MASEMKSEMG-EVIREFKASE 115 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~-~~~~h~~~v~~v~~~~~~~~l~s-~~~dg-----~i~~wd~~~~-~~~~~~~~~~ 115 (340)
+.+.....+.|.+-|......... +. +...|...+|||||+.|+. .+..+ .|++-++.+. .-+.++....
T Consensus 321 iAfv~~~~~~L~~~D~dG~n~~~ve~~--~~~~i~sP~~SPDG~~vAY~ts~e~~~g~s~vYv~~L~t~~~~~vkl~ve~ 398 (912)
T TIGR02171 321 LAFRNDVTGNLAYIDYTKGASRAVEIE--DTISVYHPDISPDGKKVAFCTGIEGLPGKSSVYVRNLNASGSGLVKLPVEN 398 (912)
T ss_pred EEEEEcCCCeEEEEecCCCCceEEEec--CCCceecCcCCCCCCEEEEEEeecCCCCCceEEEEehhccCCCceEeeccc
Confidence 333333446888888776554432 33 7789999999999999888 44443 4888887753 2334555556
Q ss_pred CCeeEEEEccCCCEEEE
Q 036605 116 KPISSSAFLCEEKIFAL 132 (340)
Q Consensus 116 ~~i~~l~~~~~~~~l~~ 132 (340)
..|..-.+.++|..+++
T Consensus 399 aaiprwrv~e~gdt~iv 415 (912)
T TIGR02171 399 AAIPRWRVLENGDTVIV 415 (912)
T ss_pred ccccceEecCCCCeEEE
Confidence 66776677777765543
No 494
>PF14779 BBS1: Ciliary BBSome complex subunit 1
Probab=79.11 E-value=26 Score=28.89 Aligned_cols=77 Identities=14% Similarity=0.116 Sum_probs=47.8
Q ss_pred CCCCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEEEEec----CCCEEEEEeCCC
Q 036605 20 PVVSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGLAFAK----KGRSLHVVGTNG 95 (340)
Q Consensus 20 ~~~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v~~~~----~~~~l~s~~~dg 95 (340)
....|+||+--.... .-+.+...|+.|+.+|.|+|.|.+....+.++.- ..-++ .+..+. -+-.++.++.||
T Consensus 175 ~~t~ITcm~tikk~~--~d~~a~scLViGTE~~~i~iLd~~af~il~~~~l-psvPv-~i~~~G~~devdyRI~Va~Rdg 250 (257)
T PF14779_consen 175 RQTVITCMATIKKSS--ADEDAVSCLVIGTESGEIYILDPQAFTILKQVQL-PSVPV-FISVSGQYDEVDYRIVVACRDG 250 (257)
T ss_pred cCceeEEeeeecccc--cCCCCcceEEEEecCCeEEEECchhheeEEEEec-CCCce-EEEEEeeeeccceEEEEEeCCC
Confidence 456788988743221 1122445899999999999999888777766653 22222 222221 123567778888
Q ss_pred cEEEE
Q 036605 96 MASEM 100 (340)
Q Consensus 96 ~i~~w 100 (340)
.|++.
T Consensus 251 ~iy~i 255 (257)
T PF14779_consen 251 KIYTI 255 (257)
T ss_pred EEEEE
Confidence 88764
No 495
>KOG2247 consensus WD40 repeat-containing protein [General function prediction only]
Probab=79.02 E-value=0.39 Score=42.54 Aligned_cols=99 Identities=18% Similarity=0.126 Sum_probs=70.6
Q ss_pred CCeEEEEeeccccccccccCceEEEEEcCCCcEEEEEccCCeeEEEe--cCCCCCCeEEEEEecCCCEEEEEeCCCcEEE
Q 036605 22 VSYSCLACGFVGKKRRKERGTLLLALGTSNGDILAVDVLTGEMKWKS--TGRHPGGLAGLAFAKKGRSLHVVGTNGMASE 99 (340)
Q Consensus 22 ~~v~~l~~sp~~~~~~~~~~~~~l~~g~~dg~i~i~d~~~~~~~~~~--~~~h~~~v~~v~~~~~~~~l~s~~~dg~i~~ 99 (340)
.....|+|..++. ..++.+-..+.+.+||+.+.. ...+ .+.|.... +.|++....++.+...|.+.+
T Consensus 75 g~aldm~wDkegd--------vlavlAek~~piylwd~n~ey-tqqLE~gg~~s~sl--l~wsKg~~el~ig~~~gn~vi 143 (615)
T KOG2247|consen 75 GKALDMAWDKEGD--------VLAVLAEKTGPIYLWDVNSEY-TQQLESGGTSSKSL--LAWSKGTPELVIGNNAGNIVI 143 (615)
T ss_pred hhHhhhhhccccc--------hhhhhhhcCCCeeechhhhhh-HHHHhccCcchHHH--HhhccCCccccccccccceEE
Confidence 4555677776663 266777888999999987653 2222 22233333 788988888888888899999
Q ss_pred EeCCCCeEEEEeecCCCCeeEEEEccCCCEEE
Q 036605 100 MKSEMGEVIREFKASEKPISSSAFLCEEKIFA 131 (340)
Q Consensus 100 wd~~~~~~~~~~~~~~~~i~~l~~~~~~~~l~ 131 (340)
++..+.+.....-.|...+.++++.+.+..+.
T Consensus 144 ynhgtsR~iiv~Gkh~RRgtq~av~lEd~vil 175 (615)
T KOG2247|consen 144 YNHGTSRRIIVMGKHQRRGTQIAVTLEDYVIL 175 (615)
T ss_pred EeccchhhhhhhcccccceeEEEecccceeee
Confidence 99888776655555788889999988765543
No 496
>KOG4460 consensus Nuclear pore complex, Nup88/rNup84 component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=78.79 E-value=53 Score=30.13 Aligned_cols=25 Identities=12% Similarity=0.118 Sum_probs=15.0
Q ss_pred eeEEEEccCCCEEEEecCc-EEEEEC
Q 036605 118 ISSSAFLCEEKIFALASSE-VRILSL 142 (340)
Q Consensus 118 i~~l~~~~~~~~l~~~~~~-i~i~d~ 142 (340)
|..+..++.|..++..+-+ |.+..+
T Consensus 106 V~~vl~s~~GS~VaL~G~~Gi~vMeL 131 (741)
T KOG4460|consen 106 VYQVLLSPTGSHVALIGIKGLMVMEL 131 (741)
T ss_pred EEEEEecCCCceEEEecCCeeEEEEc
Confidence 4566677777777665444 444444
No 497
>TIGR03054 photo_alph_chp1 putative photosynthetic complex assembly protein. In twenty or so anoxygenic photosynthetic alpha-Proteobacteria known so far, a gene for a member of this protein family is present and is found in the vicinity of puhA, which encodes a component of the photosynthetic reaction center, and other genes associated with photosynthesis. This protein family is suggested, consequently, as a probable assembly factor for the photosynthetic reaction center, but its seems its actual function has not yet been demonstrated.
Probab=78.37 E-value=17 Score=26.60 Aligned_cols=66 Identities=15% Similarity=0.080 Sum_probs=50.1
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCCCCCCeEEE-----------EEecCCCEEEEEeCCCcEEEEeCCCCeEEE
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGRHPGGLAGL-----------AFAKKGRSLHVVGTNGMASEMKSEMGEVIR 109 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~h~~~v~~v-----------~~~~~~~~l~s~~~dg~i~~wd~~~~~~~~ 109 (340)
+.+.+..||.|.+++..+|+.+..+..++.+.|..+ ....+..+-++--.||.+.+-|..||..+.
T Consensus 43 l~f~d~~~G~v~V~~~~~G~~va~~~~g~~GFvrgvlR~l~R~R~~~gv~~~~Pf~L~r~~dGrltL~Dp~Tg~~i~ 119 (135)
T TIGR03054 43 LVFEDRPDGAVAVVETPDGRLVAILEPGQNGFVRVMLRGLARARARAGVAAEPPFRLTRYDNGRLTLTDPATGWSIE 119 (135)
T ss_pred EEEecCCCCeEEEEECCCCCEEEEecCCCCchhhHhHHHHHHHHHHcCCCCCCCEEEEEEeCCcEEEEcCCCCcEEE
Confidence 567778899999999999999998876455544432 123445677788899999999999987653
No 498
>PF03022 MRJP: Major royal jelly protein; InterPro: IPR003534 The major royal jelly proteins (MRJPs) comprise 12.5% of the mass, and 82-90% of the protein content [], of honeybee (Apis mellifera) royal jelly. Royal jelly is a substance secreted by the cephalic glands of nurse bees [] and it is used to trigger development of a queen bee from a bee larva. The biological function of the MRJPs is unknown, but they are believed to play a major role in nutrition due to their high essential amino acid content []. Two royal jelly proteins, MRJP3 and MRJP5, contain a tandem repeat that results from a high genetic variablility. This polymorphism may be useful for genotyping individual bees [].; PDB: 3Q6P_B 3Q6K_A 3Q6T_A 2QE8_B.
Probab=77.90 E-value=42 Score=28.42 Aligned_cols=132 Identities=11% Similarity=0.111 Sum_probs=75.0
Q ss_pred cEEEEEccCCeeEEEecC-----CCCCCeEEEEEecCC-----CEEEEEeC-CCcEEEEeCCCCeEEEEeecC-------
Q 036605 53 DILAVDVLTGEMKWKSTG-----RHPGGLAGLAFAKKG-----RSLHVVGT-NGMASEMKSEMGEVIREFKAS------- 114 (340)
Q Consensus 53 ~i~i~d~~~~~~~~~~~~-----~h~~~v~~v~~~~~~-----~~l~s~~~-dg~i~~wd~~~~~~~~~~~~~------- 114 (340)
.|.+||+.+++.++++.- ...+.+..+.+.... .+++.... .+.|.|+|+.+++..+.+..+
T Consensus 35 KLv~~Dl~t~~li~~~~~p~~~~~~~s~lndl~VD~~~~~~~~~~aYItD~~~~glIV~dl~~~~s~Rv~~~~~~~~p~~ 114 (287)
T PF03022_consen 35 KLVAFDLKTNQLIRRYPFPPDIAPPDSFLNDLVVDVRDGNCDDGFAYITDSGGPGLIVYDLATGKSWRVLHNSFSPDPDA 114 (287)
T ss_dssp EEEEEETTTTCEEEEEE--CCCS-TCGGEEEEEEECTTTTS-SEEEEEEETTTCEEEEEETTTTEEEEEETCGCTTS-SS
T ss_pred EEEEEECCCCcEEEEEECChHHcccccccceEEEEccCCCCcceEEEEeCCCcCcEEEEEccCCcEEEEecCCcceeccc
Confidence 788999999998777643 123467888887632 35555543 368999999998765443211
Q ss_pred ------------CCCeeEEEEcc---CCCEEEEec-CcEEEEECCC-----Cc---------eeEEeecCCCCeEEEEEC
Q 036605 115 ------------EKPISSSAFLC---EEKIFALAS-SEVRILSLEN-----GE---------EVLKFSDDVGPLQYVSAS 164 (340)
Q Consensus 115 ------------~~~i~~l~~~~---~~~~l~~~~-~~i~i~d~~~-----~~---------~~~~~~~~~~~v~~~~~s 164 (340)
...+..++.+| +++.|+... ...++|-+.+ .. .+..+-........++++
T Consensus 115 ~~~~i~g~~~~~~dg~~gial~~~~~d~r~LYf~~lss~~ly~v~T~~L~~~~~~~~~~~~~~v~~lG~k~~~s~g~~~D 194 (287)
T PF03022_consen 115 GPFTIGGESFQWPDGIFGIALSPISPDGRWLYFHPLSSRKLYRVPTSVLRDPSLSDAQALASQVQDLGDKGSQSDGMAID 194 (287)
T ss_dssp EEEEETTEEEEETTSEEEEEE-TTSTTS-EEEEEETT-SEEEEEEHHHHCSTT--HHH-HHHT-EEEEE---SECEEEEE
T ss_pred cceeccCceEecCCCccccccCCCCCCccEEEEEeCCCCcEEEEEHHHhhCccccccccccccceeccccCCCCceEEEC
Confidence 12355566655 555664421 1123333221 11 112221112456778889
Q ss_pred CCCCEEEEEEcCCCeEEEEEc
Q 036605 165 DGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 165 ~~~~~l~s~~~~d~~i~iwd~ 185 (340)
++|..+++ ....+.|..|+.
T Consensus 195 ~~G~ly~~-~~~~~aI~~w~~ 214 (287)
T PF03022_consen 195 PNGNLYFT-DVEQNAIGCWDP 214 (287)
T ss_dssp TTTEEEEE-ECCCTEEEEEET
T ss_pred CCCcEEEe-cCCCCeEEEEeC
Confidence 98866666 444899999997
No 499
>PF03088 Str_synth: Strictosidine synthase; InterPro: IPR018119 This entry represents a conserved region found in strictosidine synthase (4.3.3.2 from EC), a key enzyme in alkaloid biosynthesis. It catalyses the Pictet-Spengler stereospecific condensation of tryptamine with secologanin to form strictosidine []. The structure of the native enzyme from the Indian medicinal plant Rauvolfia serpentina (Serpentwood) (Devilpepper) represents the first example of a six-bladed four-stranded beta-propeller fold from the plant kingdom [].; GO: 0016844 strictosidine synthase activity, 0009058 biosynthetic process; PDB: 2FPB_A 2V91_B 2FP8_A 3V1S_B 2FPC_A 2VAQ_A 2FP9_B.
Probab=77.82 E-value=19 Score=24.29 Aligned_cols=40 Identities=10% Similarity=0.016 Sum_probs=27.3
Q ss_pred CcEEEEECCCCceeEEeecCCCCeEEEEECCCCCEEEEEEc
Q 036605 135 SEVRILSLENGEEVLKFSDDVGPLQYVSASDGAKIIITAGY 175 (340)
Q Consensus 135 ~~i~i~d~~~~~~~~~~~~~~~~v~~~~~s~~~~~l~s~~~ 175 (340)
+.+..||..+++....+.+ -...+.+++++|+.+++.+-.
T Consensus 37 GRll~ydp~t~~~~vl~~~-L~fpNGVals~d~~~vlv~Et 76 (89)
T PF03088_consen 37 GRLLRYDPSTKETTVLLDG-LYFPNGVALSPDESFVLVAET 76 (89)
T ss_dssp EEEEEEETTTTEEEEEEEE-ESSEEEEEE-TTSSEEEEEEG
T ss_pred cCEEEEECCCCeEEEehhC-CCccCeEEEcCCCCEEEEEec
Confidence 3378899998865333333 345689999999998888544
No 500
>COG5276 Uncharacterized conserved protein [Function unknown]
Probab=76.42 E-value=46 Score=28.12 Aligned_cols=136 Identities=12% Similarity=0.045 Sum_probs=83.7
Q ss_pred EEEEEcCCCcEEEEEccCCeeEEEecCC-CCCCeEEEEEecCCCEEEEEeCCCcEEEEeCCCCe---EEEEeecCCCCee
Q 036605 44 LLALGTSNGDILAVDVLTGEMKWKSTGR-HPGGLAGLAFAKKGRSLHVVGTNGMASEMKSEMGE---VIREFKASEKPIS 119 (340)
Q Consensus 44 ~l~~g~~dg~i~i~d~~~~~~~~~~~~~-h~~~v~~v~~~~~~~~l~s~~~dg~i~~wd~~~~~---~~~~~~~~~~~i~ 119 (340)
+...+..+.-++|.|+.+......+..- -.+--.++..+ |++++.+..|.-+.+.|+.+.. ...+.........
T Consensus 98 yvyvad~ssGL~IvDIS~P~sP~~~~~lnt~gyaygv~vs--Gn~aYVadlddgfLivdvsdpssP~lagrya~~~~d~~ 175 (370)
T COG5276 98 YVYVADWSSGLRIVDISTPDSPTLIGFLNTDGYAYGVYVS--GNYAYVADLDDGFLIVDVSDPSSPQLAGRYALPGGDTH 175 (370)
T ss_pred EEEEEcCCCceEEEeccCCCCcceeccccCCceEEEEEec--CCEEEEeeccCcEEEEECCCCCCceeeeeeccCCCCce
Confidence 6777777888999999887633222210 22344555554 8999999866666777876543 3333444444456
Q ss_pred EEEEccCCCEEEEecCcEEEEECCCCceeEEeecC---CCCeEEEEECCCCCEEEEEEcCCCeEEEEEc
Q 036605 120 SSAFLCEEKIFALASSEVRILSLENGEEVLKFSDD---VGPLQYVSASDGAKIIITAGYGEKHLQVWRC 185 (340)
Q Consensus 120 ~l~~~~~~~~l~~~~~~i~i~d~~~~~~~~~~~~~---~~~v~~~~~s~~~~~l~s~~~~d~~i~iwd~ 185 (340)
.+++|-+..+.+.-++-+.+.|+...... .|.+| ...+.++..+++--+++. . +.-+.+-|.
T Consensus 176 ~v~ISGn~AYvA~~d~GL~ivDVSnp~sP-vli~~~n~g~g~~sv~vsdnr~y~vv--y-~egvlivd~ 240 (370)
T COG5276 176 DVAISGNYAYVAWRDGGLTIVDVSNPHSP-VLIGSYNTGPGTYSVSVSDNRAYLVV--Y-DEGVLIVDV 240 (370)
T ss_pred eEEEecCeEEEEEeCCCeEEEEccCCCCC-eEEEEEecCCceEEEEecCCeeEEEE--c-ccceEEEec
Confidence 77888666666666666999998765332 22222 236777777877656555 2 345556665
Done!