Query 020784
Match_columns 321
No_of_seqs 255 out of 2107
Neff 9.2
Searched_HMMs 46136
Date Fri Mar 29 05:07:48 2013
Command hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/020784.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/020784hhsearch_cdd -cpu 12 -v 0
No Hit Prob E-value P-value Score SS Cols Query HMM Template HMM
1 KOG2111 Uncharacterized conser 100.0 3.7E-35 8.1E-40 251.1 25.7 232 87-319 7-245 (346)
2 KOG2110 Uncharacterized conser 100.0 2.6E-31 5.5E-36 231.6 27.1 226 86-319 6-237 (391)
3 KOG0271 Notchless-like WD40 re 100.0 1.1E-31 2.4E-36 234.5 21.2 232 82-317 112-468 (480)
4 KOG0272 U4/U6 small nuclear ri 100.0 2.2E-32 4.8E-37 241.4 15.9 238 69-319 201-449 (459)
5 KOG0272 U4/U6 small nuclear ri 100.0 1.4E-30 3E-35 230.1 17.8 224 83-319 173-407 (459)
6 KOG0273 Beta-transducin family 100.0 2.9E-28 6.4E-33 218.0 24.7 222 84-318 234-511 (524)
7 KOG0291 WD40-repeat-containing 100.0 5.9E-28 1.3E-32 226.4 26.9 225 84-319 306-539 (893)
8 KOG0315 G-protein beta subunit 100.0 5.2E-28 1.1E-32 201.1 23.1 224 84-319 39-277 (311)
9 KOG0279 G protein beta subunit 100.0 1.6E-27 3.4E-32 201.1 25.5 229 80-319 10-252 (315)
10 KOG0286 G-protein beta subunit 100.0 2.8E-27 6.1E-32 200.7 25.9 228 79-317 49-290 (343)
11 KOG0263 Transcription initiati 100.0 1.3E-28 2.9E-33 232.0 19.0 198 81-290 447-650 (707)
12 KOG0263 Transcription initiati 100.0 3.6E-28 7.9E-33 229.1 21.2 231 76-319 370-638 (707)
13 KOG0315 G-protein beta subunit 100.0 6.8E-27 1.5E-31 194.5 22.5 214 82-309 80-307 (311)
14 KOG0295 WD40 repeat-containing 100.0 2.8E-27 6.1E-32 205.8 19.6 221 82-312 147-386 (406)
15 KOG0279 G protein beta subunit 100.0 4.9E-26 1.1E-30 192.1 23.7 205 81-298 59-271 (315)
16 KOG0276 Vesicle coat complex C 99.9 2.3E-26 4.9E-31 211.9 21.0 210 83-302 53-270 (794)
17 KOG0292 Vesicle coat complex C 99.9 6E-26 1.3E-30 216.0 24.0 225 81-317 47-309 (1202)
18 KOG0278 Serine/threonine kinas 99.9 1.5E-26 3.3E-31 192.6 16.2 200 82-294 97-302 (334)
19 KOG0291 WD40-repeat-containing 99.9 5E-25 1.1E-29 206.8 26.6 224 82-317 347-599 (893)
20 KOG0266 WD40 repeat-containing 99.9 5.7E-25 1.2E-29 209.1 27.6 223 82-317 156-396 (456)
21 KOG1407 WD40 repeat protein [F 99.9 3E-25 6.6E-30 185.8 19.3 227 81-319 16-250 (313)
22 KOG0286 G-protein beta subunit 99.9 7E-25 1.5E-29 186.2 21.7 195 81-287 141-343 (343)
23 cd00200 WD40 WD40 domain, foun 99.9 1.8E-23 3.8E-28 183.1 30.1 224 82-318 6-237 (289)
24 KOG0265 U5 snRNP-specific prot 99.9 1.3E-24 2.9E-29 185.1 21.3 205 81-298 43-259 (338)
25 KOG0285 Pleiotropic regulator 99.9 8.9E-25 1.9E-29 190.0 19.7 218 78-309 144-367 (460)
26 KOG0293 WD40 repeat-containing 99.9 4.1E-25 8.9E-30 195.1 15.9 199 82-290 221-514 (519)
27 KOG0284 Polyadenylation factor 99.9 7.9E-26 1.7E-30 199.3 10.8 213 86-311 97-315 (464)
28 KOG0295 WD40 repeat-containing 99.9 2.4E-24 5.2E-29 187.6 18.9 247 58-318 82-352 (406)
29 PTZ00421 coronin; Provisional 99.9 1.2E-22 2.6E-27 193.5 30.9 217 81-308 71-309 (493)
30 KOG0316 Conserved WD40 repeat- 99.9 5E-24 1.1E-28 176.2 17.4 205 82-302 14-225 (307)
31 PLN00181 protein SPA1-RELATED; 99.9 1.3E-22 2.9E-27 205.6 31.6 224 83-319 481-727 (793)
32 KOG0266 WD40 repeat-containing 99.9 5.6E-23 1.2E-27 195.5 26.4 223 82-317 200-439 (456)
33 KOG0284 Polyadenylation factor 99.9 4.3E-25 9.4E-30 194.7 10.9 228 79-318 132-368 (464)
34 KOG0276 Vesicle coat complex C 99.9 1.3E-23 2.8E-28 193.9 20.1 218 84-313 12-238 (794)
35 cd00200 WD40 WD40 domain, foun 99.9 1.2E-21 2.6E-26 171.5 30.0 225 82-319 48-280 (289)
36 KOG1036 Mitotic spindle checkp 99.9 9.7E-23 2.1E-27 174.4 21.5 225 82-319 51-293 (323)
37 KOG0643 Translation initiation 99.9 4.5E-22 9.8E-27 167.3 24.5 218 81-310 6-241 (327)
38 KOG0296 Angio-associated migra 99.9 2.2E-22 4.8E-27 175.5 23.5 227 80-318 101-386 (399)
39 KOG0282 mRNA splicing factor [ 99.9 4.2E-24 9.1E-29 192.0 13.1 226 81-319 210-494 (503)
40 KOG0271 Notchless-like WD40 re 99.9 2.4E-23 5.2E-28 182.5 17.1 193 82-287 197-479 (480)
41 PLN00181 protein SPA1-RELATED; 99.9 8.7E-22 1.9E-26 199.7 31.0 221 85-318 532-781 (793)
42 KOG2096 WD40 repeat protein [G 99.9 7.4E-23 1.6E-27 175.8 19.6 228 80-318 81-349 (420)
43 KOG0318 WD40 repeat stress pro 99.9 9.3E-22 2E-26 178.6 27.0 216 78-302 52-278 (603)
44 KOG0310 Conserved WD40 repeat- 99.9 2.6E-22 5.6E-27 180.7 22.7 219 86-317 69-296 (487)
45 KOG0647 mRNA export protein (c 99.9 3E-22 6.5E-27 170.9 21.8 228 81-319 68-312 (347)
46 PTZ00420 coronin; Provisional 99.9 3.1E-21 6.8E-26 185.1 30.7 204 81-293 70-297 (568)
47 KOG0645 WD40 repeat protein [G 99.9 2.7E-21 5.8E-26 162.9 26.1 200 79-289 8-225 (312)
48 KOG0265 U5 snRNP-specific prot 99.9 5.5E-22 1.2E-26 169.2 21.1 232 76-319 81-327 (338)
49 KOG0281 Beta-TrCP (transducin 99.9 1.7E-23 3.7E-28 181.5 12.0 192 81-292 233-431 (499)
50 KOG0319 WD40-repeat-containing 99.9 1.8E-22 3.8E-27 189.5 18.9 224 80-316 360-605 (775)
51 KOG0650 WD40 repeat nucleolar 99.9 7.6E-23 1.7E-27 188.0 14.8 225 55-287 372-678 (733)
52 KOG0274 Cdc4 and related F-box 99.9 2.7E-21 6E-26 184.8 24.5 203 81-300 245-452 (537)
53 KOG0316 Conserved WD40 repeat- 99.9 1.3E-21 2.9E-26 161.9 19.2 231 69-313 43-281 (307)
54 KOG0274 Cdc4 and related F-box 99.9 1.3E-21 2.8E-26 187.1 21.6 216 84-317 207-428 (537)
55 KOG0289 mRNA splicing factor [ 99.9 3.7E-21 8E-26 171.1 22.5 223 86-318 220-450 (506)
56 KOG0282 mRNA splicing factor [ 99.9 8.3E-23 1.8E-27 183.7 12.1 196 82-287 255-503 (503)
57 KOG0306 WD40-repeat-containing 99.9 1.9E-21 4.2E-26 182.8 21.5 226 82-318 370-652 (888)
58 KOG0273 Beta-transducin family 99.9 4.7E-21 1E-25 172.0 23.0 197 82-289 273-523 (524)
59 KOG0288 WD40 repeat protein Ti 99.9 5.5E-22 1.2E-26 175.4 16.4 223 83-318 217-449 (459)
60 KOG1407 WD40 repeat protein [F 99.9 1.3E-20 2.9E-25 158.0 23.5 225 81-318 60-290 (313)
61 KOG0645 WD40 repeat protein [G 99.9 1.2E-20 2.6E-25 159.0 22.8 198 80-289 56-311 (312)
62 KOG0281 Beta-TrCP (transducin 99.9 2.5E-23 5.3E-28 180.5 6.8 207 86-313 198-411 (499)
63 KOG0285 Pleiotropic regulator 99.9 8.8E-22 1.9E-26 171.4 16.3 175 126-312 150-329 (460)
64 KOG0292 Vesicle coat complex C 99.9 7.8E-22 1.7E-26 188.2 17.3 215 85-312 9-260 (1202)
65 KOG0318 WD40 repeat stress pro 99.9 2.2E-20 4.8E-25 169.7 25.8 224 82-317 187-422 (603)
66 KOG0319 WD40-repeat-containing 99.9 1.7E-21 3.6E-26 183.0 18.8 199 81-290 407-620 (775)
67 KOG0283 WD40 repeat-containing 99.9 3.7E-21 8E-26 183.3 20.7 224 82-319 264-565 (712)
68 KOG0641 WD40 repeat protein [G 99.9 1.1E-19 2.4E-24 149.8 26.6 206 76-290 80-304 (350)
69 KOG0640 mRNA cleavage stimulat 99.9 5E-21 1.1E-25 164.1 19.3 209 82-299 109-345 (430)
70 KOG0277 Peroxisomal targeting 99.9 1.8E-21 3.9E-26 162.7 15.4 227 79-317 54-296 (311)
71 KOG4283 Transcription-coupled 99.9 1.4E-20 3E-25 160.4 18.5 207 77-292 35-279 (397)
72 KOG1446 Histone H3 (Lys4) meth 99.9 3.9E-19 8.5E-24 152.9 27.6 222 85-318 14-291 (311)
73 KOG0275 Conserved WD40 repeat- 99.9 1.7E-21 3.6E-26 167.9 12.9 225 82-318 210-455 (508)
74 KOG0772 Uncharacterized conser 99.9 2.2E-20 4.8E-25 169.3 20.5 225 82-318 164-427 (641)
75 KOG0299 U3 snoRNP-associated p 99.9 6.1E-20 1.3E-24 164.5 20.6 222 83-318 200-443 (479)
76 PTZ00421 coronin; Provisional 99.9 6.6E-19 1.4E-23 167.9 28.4 220 87-318 22-277 (493)
77 KOG0294 WD40 repeat-containing 99.9 1.6E-19 3.5E-24 155.1 21.6 211 82-306 80-303 (362)
78 KOG0973 Histone transcription 99.9 1.6E-19 3.5E-24 176.1 23.5 230 81-319 65-344 (942)
79 KOG0268 Sof1-like rRNA process 99.8 9.7E-21 2.1E-25 165.2 12.2 222 82-317 63-332 (433)
80 KOG0308 Conserved WD40 repeat- 99.8 2.1E-20 4.5E-25 173.5 15.0 199 95-304 35-257 (735)
81 KOG0267 Microtubule severing p 99.8 5.8E-21 1.3E-25 179.0 9.6 221 83-315 26-253 (825)
82 KOG0305 Anaphase promoting com 99.8 3.6E-19 7.8E-24 165.4 21.1 227 83-319 215-450 (484)
83 KOG0646 WD40 repeat protein [G 99.8 3.7E-19 8.1E-24 159.7 20.2 202 84-298 80-316 (476)
84 KOG0313 Microtubule binding pr 99.8 5E-19 1.1E-23 155.4 20.2 195 82-289 190-418 (423)
85 PTZ00420 coronin; Provisional 99.8 7E-18 1.5E-22 162.1 29.2 198 108-318 56-281 (568)
86 KOG0296 Angio-associated migra 99.8 1.7E-18 3.7E-23 151.4 21.5 225 81-319 60-345 (399)
87 KOG0277 Peroxisomal targeting 99.8 1.1E-18 2.3E-23 146.2 18.4 220 89-318 12-253 (311)
88 KOG0313 Microtubule binding pr 99.8 2.4E-18 5.2E-23 151.1 21.3 224 81-317 140-405 (423)
89 KOG0305 Anaphase promoting com 99.8 1.3E-18 2.8E-23 161.7 20.7 211 89-312 181-399 (484)
90 KOG1273 WD40 repeat protein [G 99.8 7.3E-18 1.6E-22 145.1 21.4 203 88-302 26-292 (405)
91 TIGR03866 PQQ_ABC_repeats PQQ- 99.8 1.3E-16 2.8E-21 142.6 29.4 220 87-318 32-266 (300)
92 KOG1408 WD40 repeat protein [F 99.8 1.5E-18 3.1E-23 162.8 16.9 198 83-290 457-714 (1080)
93 KOG0288 WD40 repeat protein Ti 99.8 5.5E-19 1.2E-23 156.5 12.5 223 82-319 172-406 (459)
94 KOG0264 Nucleosome remodeling 99.8 6.2E-18 1.3E-22 151.5 18.9 221 82-312 121-383 (422)
95 KOG0641 WD40 repeat protein [G 99.8 1.5E-16 3.3E-21 131.3 25.6 221 86-319 33-292 (350)
96 KOG0299 U3 snoRNP-associated p 99.8 3.8E-18 8.1E-23 153.1 17.0 210 81-302 138-369 (479)
97 KOG1332 Vesicle coat complex C 99.8 3.3E-18 7.1E-23 142.5 15.4 229 79-318 5-274 (299)
98 KOG0310 Conserved WD40 repeat- 99.8 2.4E-17 5.3E-22 148.8 21.8 197 82-289 107-309 (487)
99 KOG0306 WD40-repeat-containing 99.8 1.1E-17 2.4E-22 157.8 19.6 202 82-296 451-671 (888)
100 TIGR03866 PQQ_ABC_repeats PQQ- 99.8 4.8E-16 1E-20 138.9 29.7 213 87-308 74-298 (300)
101 KOG0643 Translation initiation 99.8 2.5E-17 5.5E-22 138.8 19.6 216 67-290 34-318 (327)
102 KOG0289 mRNA splicing factor [ 99.8 5.3E-17 1.2E-21 144.8 21.6 201 78-288 296-505 (506)
103 KOG0640 mRNA cleavage stimulat 99.8 9.4E-18 2E-22 144.1 16.0 194 85-288 216-425 (430)
104 KOG1539 WD repeat protein [Gen 99.8 4.4E-17 9.5E-22 155.3 21.8 221 87-319 397-636 (910)
105 KOG0283 WD40 repeat-containing 99.8 3.2E-17 6.9E-22 156.6 20.9 199 80-290 364-577 (712)
106 KOG0973 Histone transcription 99.8 1.8E-17 3.9E-22 162.0 17.6 202 85-318 13-237 (942)
107 KOG0269 WD40 repeat-containing 99.8 8.2E-18 1.8E-22 159.1 14.5 222 86-317 40-281 (839)
108 KOG0300 WD40 repeat-containing 99.8 5E-17 1.1E-21 140.1 17.5 215 82-309 145-407 (481)
109 KOG0639 Transducin-like enhanc 99.8 1.1E-17 2.4E-22 151.5 14.0 223 84-318 464-692 (705)
110 KOG0278 Serine/threonine kinas 99.8 4E-17 8.7E-22 136.5 16.1 221 82-317 11-284 (334)
111 KOG0275 Conserved WD40 repeat- 99.8 1.3E-17 2.9E-22 143.9 13.6 207 83-299 261-477 (508)
112 KOG0639 Transducin-like enhanc 99.8 1.2E-16 2.5E-21 145.0 19.9 222 82-316 416-649 (705)
113 KOG2055 WD40 repeat protein [G 99.8 5.1E-17 1.1E-21 146.0 17.2 225 84-318 256-500 (514)
114 KOG0269 WD40 repeat-containing 99.7 8.6E-18 1.9E-22 159.0 12.0 214 87-312 89-319 (839)
115 KOG0647 mRNA export protein (c 99.7 3.2E-16 6.9E-21 134.3 19.5 195 82-291 24-230 (347)
116 KOG0294 WD40 repeat-containing 99.7 1E-15 2.2E-20 131.9 21.5 221 81-319 39-270 (362)
117 KOG1274 WD40 repeat protein [G 99.7 1.5E-15 3.3E-20 146.3 23.9 226 80-319 8-251 (933)
118 KOG0264 Nucleosome remodeling 99.7 2.2E-16 4.8E-21 141.6 16.6 198 82-290 174-405 (422)
119 KOG0302 Ribosome Assembly prot 99.7 5E-16 1.1E-20 136.6 18.3 196 83-290 149-379 (440)
120 KOG0308 Conserved WD40 repeat- 99.7 2.3E-16 5E-21 146.9 16.4 210 83-303 71-300 (735)
121 KOG1272 WD40-repeat-containing 99.7 2.4E-17 5.3E-22 148.1 8.9 210 88-312 132-346 (545)
122 KOG1446 Histone H3 (Lys4) meth 99.7 3.8E-15 8.3E-20 128.4 21.7 194 82-289 97-303 (311)
123 KOG2445 Nuclear pore complex c 99.7 4.1E-15 8.9E-20 127.8 21.5 209 79-298 7-330 (361)
124 KOG1539 WD repeat protein [Gen 99.7 8.3E-16 1.8E-20 146.7 18.3 195 86-290 449-649 (910)
125 KOG0267 Microtubule severing p 99.7 6.8E-17 1.5E-21 151.9 9.3 188 81-279 66-259 (825)
126 KOG0307 Vesicle coat complex C 99.7 1.5E-16 3.3E-21 156.3 11.5 224 86-318 65-315 (1049)
127 KOG0301 Phospholipase A2-activ 99.7 1.7E-15 3.6E-20 142.1 17.4 217 82-317 11-236 (745)
128 KOG0300 WD40 repeat-containing 99.7 3E-15 6.6E-20 129.2 17.7 198 81-291 268-478 (481)
129 KOG0301 Phospholipase A2-activ 99.7 5.4E-15 1.2E-19 138.7 19.7 195 84-298 56-256 (745)
130 KOG0270 WD40 repeat-containing 99.7 2.1E-15 4.5E-20 135.1 15.8 192 89-290 177-405 (463)
131 KOG0270 WD40 repeat-containing 99.7 2.1E-15 4.5E-20 135.1 15.7 203 83-295 241-455 (463)
132 KOG1007 WD repeat protein TSSC 99.7 3.7E-15 8E-20 127.2 15.8 195 84-289 122-361 (370)
133 KOG0646 WD40 repeat protein [G 99.7 3.7E-15 8E-20 134.2 16.6 190 69-269 107-330 (476)
134 KOG4328 WD40 protein [Function 99.7 6.3E-15 1.4E-19 132.5 17.7 227 82-319 183-439 (498)
135 KOG0268 Sof1-like rRNA process 99.7 2.1E-15 4.6E-20 132.0 14.3 199 79-292 103-348 (433)
136 KOG1274 WD40 repeat protein [G 99.6 1.7E-14 3.7E-19 139.1 19.5 176 86-273 97-285 (933)
137 KOG0293 WD40 repeat-containing 99.6 1.1E-14 2.4E-19 129.5 16.7 181 126-318 223-501 (519)
138 KOG0321 WD40 repeat-containing 99.6 7.9E-15 1.7E-19 136.5 16.4 205 80-293 139-395 (720)
139 KOG2048 WD40 repeat protein [G 99.6 2.1E-13 4.5E-18 128.0 25.6 204 84-298 24-242 (691)
140 KOG1408 WD40 repeat protein [F 99.6 1.7E-14 3.6E-19 135.9 18.4 221 88-318 327-659 (1080)
141 KOG4378 Nuclear protein COP1 [ 99.6 6E-15 1.3E-19 133.8 14.6 220 87-318 36-268 (673)
142 KOG2106 Uncharacterized conser 99.6 2.1E-13 4.6E-18 124.1 24.4 215 86-319 247-466 (626)
143 KOG0771 Prolactin regulatory e 99.6 1.9E-14 4E-19 128.4 14.9 189 89-290 148-355 (398)
144 KOG1332 Vesicle coat complex C 99.6 1.8E-14 3.9E-19 120.4 13.9 203 80-289 51-286 (299)
145 KOG0772 Uncharacterized conser 99.6 5E-14 1.1E-18 128.4 17.9 218 85-312 214-467 (641)
146 KOG2106 Uncharacterized conser 99.6 5.7E-13 1.2E-17 121.4 24.0 197 80-287 99-314 (626)
147 KOG2055 WD40 repeat protein [G 99.6 1.3E-13 2.9E-18 124.2 18.9 228 81-320 209-455 (514)
148 KOG4378 Nuclear protein COP1 [ 99.6 3.6E-14 7.8E-19 128.9 15.3 214 87-311 81-302 (673)
149 KOG0290 Conserved WD40 repeat- 99.6 1.7E-13 3.7E-18 117.2 17.8 229 82-319 93-355 (364)
150 KOG1007 WD repeat protein TSSC 99.6 5E-14 1.1E-18 120.3 14.2 198 82-290 60-290 (370)
151 KOG0307 Vesicle coat complex C 99.6 8.9E-15 1.9E-19 144.0 10.7 201 82-292 113-330 (1049)
152 KOG0303 Actin-binding protein 99.6 6.9E-13 1.5E-17 117.6 21.5 204 77-292 73-297 (472)
153 KOG0322 G-protein beta subunit 99.6 5.3E-14 1.2E-18 118.8 13.6 62 225-288 260-322 (323)
154 KOG4283 Transcription-coupled 99.6 1.7E-13 3.6E-18 117.5 16.5 164 126-299 42-230 (397)
155 PRK11028 6-phosphogluconolacto 99.6 6.2E-12 1.4E-16 115.0 28.2 222 87-318 36-291 (330)
156 KOG0302 Ribosome Assembly prot 99.5 3.4E-13 7.3E-18 118.9 16.6 194 82-287 208-436 (440)
157 KOG1036 Mitotic spindle checkp 99.5 1.8E-12 3.9E-17 111.7 19.9 192 83-291 11-209 (323)
158 KOG2096 WD40 repeat protein [G 99.5 1E-12 2.2E-17 113.7 18.4 218 88-318 135-391 (420)
159 KOG2919 Guanine nucleotide-bin 99.5 3.2E-13 6.8E-18 117.1 15.0 192 87-290 160-368 (406)
160 COG2319 FOG: WD40 repeat [Gene 99.5 4.1E-11 9E-16 109.8 29.6 227 81-317 61-301 (466)
161 KOG0644 Uncharacterized conser 99.5 4.3E-14 9.4E-19 135.1 9.2 224 82-317 187-455 (1113)
162 KOG2048 WD40 repeat protein [G 99.5 8.9E-12 1.9E-16 117.1 24.1 199 82-290 66-277 (691)
163 KOG0642 Cell-cycle nuclear pro 99.5 2E-13 4.4E-18 125.7 12.9 206 82-297 341-569 (577)
164 KOG2919 Guanine nucleotide-bin 99.5 2.8E-12 6E-17 111.3 18.7 223 86-318 50-315 (406)
165 KOG1538 Uncharacterized conser 99.5 9.8E-13 2.1E-17 123.4 16.5 215 87-317 14-239 (1081)
166 KOG0650 WD40 repeat nucleolar 99.5 2.2E-13 4.9E-18 126.2 11.9 192 82-286 518-732 (733)
167 KOG1963 WD40 repeat protein [G 99.5 5.3E-12 1.2E-16 121.7 21.5 213 91-318 22-310 (792)
168 KOG1063 RNA polymerase II elon 99.5 3.3E-12 7.1E-17 120.3 19.2 213 77-298 46-308 (764)
169 COG2319 FOG: WD40 repeat [Gene 99.5 1.2E-10 2.6E-15 106.7 29.7 205 87-303 111-329 (466)
170 PRK01742 tolB translocation pr 99.5 9.4E-12 2E-16 118.0 21.2 198 83-298 201-412 (429)
171 KOG0649 WD40 repeat protein [G 99.4 5E-12 1.1E-16 105.9 15.8 154 134-298 17-195 (325)
172 KOG1034 Transcriptional repres 99.4 7.6E-13 1.7E-17 114.9 11.3 198 82-288 132-382 (385)
173 KOG3881 Uncharacterized conser 99.4 1.1E-11 2.5E-16 109.8 18.5 213 85-308 105-339 (412)
174 KOG1034 Transcriptional repres 99.4 6.9E-11 1.5E-15 102.9 22.7 156 83-247 36-211 (385)
175 KOG0321 WD40 repeat-containing 99.4 6.1E-12 1.3E-16 117.5 17.0 218 80-306 95-364 (720)
176 PRK11028 6-phosphogluconolacto 99.4 1.6E-10 3.5E-15 105.7 25.8 209 100-318 6-245 (330)
177 KOG1188 WD40 repeat protein [G 99.4 6.4E-12 1.4E-16 109.7 14.3 190 98-298 41-251 (376)
178 KOG0771 Prolactin regulatory e 99.4 5.4E-12 1.2E-16 112.8 14.0 179 131-317 148-341 (398)
179 KOG1063 RNA polymerase II elon 99.4 8.9E-12 1.9E-16 117.4 15.9 200 80-289 520-763 (764)
180 KOG1009 Chromatin assembly com 99.4 4.7E-11 1E-15 106.4 19.3 144 86-239 14-187 (434)
181 KOG1517 Guanine nucleotide bin 99.4 6.1E-11 1.3E-15 116.5 21.7 193 88-290 1067-1288(1387)
182 KOG2111 Uncharacterized conser 99.4 1.1E-10 2.3E-15 101.3 20.7 168 107-290 76-257 (346)
183 PF08662 eIF2A: Eukaryotic tra 99.4 1.1E-10 2.5E-15 98.4 20.4 158 90-298 10-187 (194)
184 KOG1445 Tumor-specific antigen 99.4 2.2E-11 4.9E-16 113.8 17.2 160 155-317 602-781 (1012)
185 KOG0303 Actin-binding protein 99.4 1.6E-11 3.4E-16 109.1 15.3 147 126-313 80-229 (472)
186 KOG1587 Cytoplasmic dynein int 99.4 3.5E-11 7.7E-16 115.2 18.8 227 82-319 239-505 (555)
187 KOG1273 WD40 repeat protein [G 99.4 3.2E-11 7E-16 104.4 16.2 202 82-290 62-323 (405)
188 KOG1538 Uncharacterized conser 99.4 5.1E-11 1.1E-15 112.1 18.6 202 80-290 48-294 (1081)
189 KOG1188 WD40 repeat protein [G 99.4 1.9E-11 4.1E-16 106.8 14.7 157 154-312 48-223 (376)
190 KOG4227 WD40 repeat protein [G 99.4 4.5E-11 9.7E-16 106.2 17.3 115 81-202 52-179 (609)
191 KOG1240 Protein kinase contain 99.4 1.4E-10 3.1E-15 115.4 21.8 216 82-306 1045-1290(1431)
192 KOG2321 WD40 repeat protein [G 99.3 1.6E-10 3.4E-15 107.1 20.1 210 84-308 50-277 (703)
193 KOG2110 Uncharacterized conser 99.3 5E-10 1.1E-14 98.9 22.1 178 98-291 57-250 (391)
194 KOG1523 Actin-related protein 99.3 4.8E-10 1E-14 97.4 20.6 198 86-292 11-239 (361)
195 KOG1310 WD40 repeat protein [G 99.3 2.3E-11 4.9E-16 112.1 13.0 210 81-298 46-312 (758)
196 PRK04922 tolB translocation pr 99.3 9E-10 1.9E-14 104.6 24.6 202 108-319 186-397 (433)
197 PRK01742 tolB translocation pr 99.3 3.3E-10 7.2E-15 107.4 21.3 198 107-319 185-390 (429)
198 PRK03629 tolB translocation pr 99.3 7.8E-10 1.7E-14 104.8 23.7 204 84-298 197-414 (429)
199 KOG2445 Nuclear pore complex c 99.3 3.1E-10 6.7E-15 98.1 17.3 155 126-290 12-257 (361)
200 PRK03629 tolB translocation pr 99.3 1.7E-09 3.6E-14 102.6 24.3 202 108-319 181-392 (429)
201 KOG1524 WD40 repeat-containing 99.3 6.2E-11 1.3E-15 109.0 13.5 194 100-319 79-275 (737)
202 KOG1009 Chromatin assembly com 99.3 5.3E-11 1.1E-15 106.1 12.4 141 174-319 12-184 (434)
203 KOG4328 WD40 protein [Function 99.3 1.4E-10 3.1E-15 104.8 14.8 181 126-316 185-385 (498)
204 PRK05137 tolB translocation pr 99.3 3.3E-09 7.2E-14 100.8 24.9 186 126-319 200-395 (435)
205 PRK04922 tolB translocation pr 99.3 2.7E-09 5.9E-14 101.3 23.8 204 84-298 202-419 (433)
206 KOG2394 WD40 protein DMR-N9 [G 99.2 1E-09 2.2E-14 101.1 19.5 156 154-312 193-384 (636)
207 KOG1963 WD40 repeat protein [G 99.2 1.3E-09 2.9E-14 105.5 21.0 226 82-318 248-527 (792)
208 PRK02889 tolB translocation pr 99.2 5.6E-09 1.2E-13 99.0 25.2 186 126-319 194-389 (427)
209 PF08662 eIF2A: Eukaryotic tra 99.2 5E-10 1.1E-14 94.5 14.9 100 216-320 61-163 (194)
210 PRK05137 tolB translocation pr 99.2 1.2E-08 2.6E-13 97.0 25.2 204 83-297 199-419 (435)
211 KOG1517 Guanine nucleotide bin 99.2 4.8E-10 1E-14 110.4 15.6 192 90-291 1170-1383(1387)
212 PRK02889 tolB translocation pr 99.1 1.4E-08 3.1E-13 96.2 22.9 202 83-298 193-411 (427)
213 TIGR02800 propeller_TolB tol-p 99.1 2.5E-08 5.5E-13 94.0 24.4 184 127-319 189-383 (417)
214 KOG4497 Uncharacterized conser 99.1 1.3E-09 2.8E-14 95.2 13.0 195 90-297 13-248 (447)
215 KOG0649 WD40 repeat protein [G 99.1 3.7E-08 8E-13 82.9 21.2 186 86-286 115-313 (325)
216 KOG4547 WD40 repeat-containing 99.1 7.9E-09 1.7E-13 96.3 19.0 156 139-306 5-188 (541)
217 KOG2139 WD40 repeat protein [G 99.1 9.1E-09 2E-13 90.9 18.3 190 86-288 99-308 (445)
218 PF02239 Cytochrom_D1: Cytochr 99.1 2.3E-07 4.9E-12 86.1 27.2 197 98-304 6-217 (369)
219 KOG1445 Tumor-specific antigen 99.1 1.3E-09 2.8E-14 102.3 11.6 196 86-292 628-847 (1012)
220 PF10282 Lactonase: Lactonase, 99.1 1.5E-06 3.2E-11 80.1 31.9 223 87-318 38-309 (345)
221 TIGR02800 propeller_TolB tol-p 99.1 9.4E-08 2E-12 90.2 24.4 203 84-297 188-404 (417)
222 PF02239 Cytochrom_D1: Cytochr 99.0 6.1E-08 1.3E-12 89.8 21.7 216 89-317 40-332 (369)
223 KOG0882 Cyclophilin-related pe 99.0 8.6E-10 1.9E-14 99.8 8.8 210 78-298 2-240 (558)
224 PRK00178 tolB translocation pr 99.0 1.5E-07 3.2E-12 89.4 24.4 203 84-297 197-413 (430)
225 PRK04792 tolB translocation pr 99.0 8.8E-08 1.9E-12 91.3 22.8 203 85-298 217-433 (448)
226 KOG0642 Cell-cycle nuclear pro 99.0 6.5E-09 1.4E-13 96.4 13.9 224 81-317 290-548 (577)
227 KOG0290 Conserved WD40 repeat- 99.0 6.9E-08 1.5E-12 83.2 18.8 192 82-285 147-361 (364)
228 KOG0644 Uncharacterized conser 99.0 5.1E-10 1.1E-14 107.7 6.5 199 81-294 228-473 (1113)
229 KOG2139 WD40 repeat protein [G 99.0 2.2E-08 4.8E-13 88.6 16.1 181 127-318 98-298 (445)
230 KOG2315 Predicted translation 99.0 5.1E-07 1.1E-11 84.1 25.3 100 216-320 272-374 (566)
231 KOG1523 Actin-related protein 99.0 1.4E-08 3.1E-13 88.3 14.2 181 127-318 10-224 (361)
232 KOG1334 WD40 repeat protein [G 99.0 3.2E-09 6.9E-14 96.9 10.6 79 210-290 387-467 (559)
233 TIGR02658 TTQ_MADH_Hv methylam 99.0 2.3E-06 5E-11 78.2 29.0 218 93-319 53-318 (352)
234 PRK00178 tolB translocation pr 99.0 3.9E-07 8.5E-12 86.5 24.8 185 127-319 198-392 (430)
235 KOG1354 Serine/threonine prote 99.0 2.1E-08 4.7E-13 88.1 14.4 202 85-297 25-310 (433)
236 PRK04792 tolB translocation pr 98.9 4.1E-07 8.9E-12 86.8 24.0 185 127-319 217-411 (448)
237 KOG1524 WD40 repeat-containing 98.9 7.7E-09 1.7E-13 95.5 11.6 216 84-318 13-244 (737)
238 PF10282 Lactonase: Lactonase, 98.9 4.5E-06 9.7E-11 77.0 30.1 204 87-296 88-331 (345)
239 KOG1587 Cytoplasmic dynein int 98.9 4.1E-08 8.9E-13 94.3 16.3 203 78-290 284-517 (555)
240 PF00400 WD40: WD domain, G-be 98.9 3.1E-09 6.8E-14 65.0 5.8 37 250-287 3-39 (39)
241 KOG4547 WD40 repeat-containing 98.9 3.6E-07 7.7E-12 85.5 21.0 183 95-290 3-221 (541)
242 KOG2321 WD40 repeat protein [G 98.9 5.2E-08 1.1E-12 90.8 15.0 179 97-315 146-328 (703)
243 PRK01029 tolB translocation pr 98.9 3.4E-06 7.4E-11 80.0 26.5 206 86-297 185-411 (428)
244 KOG0974 WD-repeat protein WDR6 98.8 1.1E-07 2.3E-12 94.1 15.6 134 183-318 97-234 (967)
245 KOG2314 Translation initiation 98.8 5.1E-07 1.1E-11 84.1 18.9 225 88-318 213-510 (698)
246 PRK01029 tolB translocation pr 98.8 2.9E-06 6.4E-11 80.4 23.7 183 130-319 187-389 (428)
247 KOG2394 WD40 protein DMR-N9 [G 98.8 3.7E-08 8E-13 91.1 9.3 93 84-184 289-383 (636)
248 KOG1064 RAVE (regulator of V-A 98.8 5.5E-08 1.2E-12 100.7 11.2 192 86-301 2209-2410(2439)
249 KOG4497 Uncharacterized conser 98.7 4.8E-06 1E-10 73.2 21.1 229 83-318 89-420 (447)
250 COG2706 3-carboxymuconate cycl 98.7 5.4E-05 1.2E-09 67.5 28.0 225 85-318 39-308 (346)
251 COG5354 Uncharacterized protei 98.7 2.3E-06 5E-11 79.0 19.6 223 86-318 33-333 (561)
252 KOG1272 WD40-repeat-containing 98.7 1.2E-08 2.6E-13 92.8 4.5 185 86-287 171-360 (545)
253 KOG4532 WD40-like repeat conta 98.7 5.3E-06 1.2E-10 71.1 19.9 201 89-297 71-290 (344)
254 PLN02919 haloacid dehalogenase 98.7 1.3E-05 2.9E-10 83.7 27.0 197 88-293 626-892 (1057)
255 KOG3914 WD repeat protein WDR4 98.7 3.5E-07 7.6E-12 82.0 13.1 84 211-299 148-233 (390)
256 PF15492 Nbas_N: Neuroblastoma 98.7 2.1E-05 4.5E-10 68.1 23.3 200 91-299 3-269 (282)
257 KOG0974 WD-repeat protein WDR6 98.7 9.2E-07 2E-11 87.6 16.0 187 91-290 93-289 (967)
258 KOG1832 HIV-1 Vpr-binding prot 98.6 1.8E-08 3.9E-13 98.0 3.3 209 82-315 1098-1316(1516)
259 TIGR02658 TTQ_MADH_Hv methylam 98.6 9.5E-05 2.1E-09 67.7 26.9 199 90-301 109-343 (352)
260 KOG0322 G-protein beta subunit 98.6 4.7E-07 1E-11 77.2 10.9 154 83-246 148-322 (323)
261 COG4946 Uncharacterized protei 98.6 3.6E-05 7.8E-10 70.8 23.1 125 75-208 349-483 (668)
262 KOG3881 Uncharacterized conser 98.6 4.3E-06 9.3E-11 74.9 16.5 223 86-318 56-308 (412)
263 PRK04043 tolB translocation pr 98.6 3.8E-05 8.2E-10 72.6 24.1 192 87-290 189-401 (419)
264 PF13360 PQQ_2: PQQ-like domai 98.6 9E-05 1.9E-09 64.1 24.8 185 95-296 35-237 (238)
265 KOG2315 Predicted translation 98.6 2.1E-05 4.5E-10 73.6 21.4 204 82-295 162-395 (566)
266 COG5170 CDC55 Serine/threonine 98.5 1.3E-06 2.8E-11 76.3 12.1 203 84-297 25-318 (460)
267 KOG4227 WD40 repeat protein [G 98.5 3.9E-06 8.5E-11 75.3 15.2 156 126-292 55-228 (609)
268 PRK04043 tolB translocation pr 98.5 0.0002 4.4E-09 67.6 27.8 182 128-319 188-386 (419)
269 KOG1310 WD40 repeat protein [G 98.5 5.7E-07 1.2E-11 83.6 9.3 153 126-288 49-230 (758)
270 COG2706 3-carboxymuconate cycl 98.5 0.00028 6E-09 63.0 25.5 203 87-295 90-329 (346)
271 PLN02919 haloacid dehalogenase 98.5 0.00027 5.8E-09 74.2 29.7 216 89-315 571-873 (1057)
272 KOG1240 Protein kinase contain 98.5 9.2E-06 2E-10 82.1 17.3 172 126-306 1047-1242(1431)
273 KOG4190 Uncharacterized conser 98.4 5.1E-07 1.1E-11 84.0 7.0 164 126-297 734-914 (1034)
274 KOG1409 Uncharacterized conser 98.4 1.4E-05 3E-10 70.7 14.7 195 85-291 68-272 (404)
275 KOG1354 Serine/threonine prote 98.4 3.4E-05 7.3E-10 68.4 16.1 168 73-248 152-360 (433)
276 KOG4714 Nucleoporin [Nuclear s 98.3 1.9E-06 4.1E-11 73.4 7.6 94 194-290 159-255 (319)
277 PF04762 IKI3: IKI3 family; I 98.3 0.00013 2.9E-09 75.2 22.3 223 84-318 74-322 (928)
278 PF03178 CPSF_A: CPSF A subuni 98.3 0.00046 1E-08 62.9 23.7 177 108-289 4-202 (321)
279 COG5354 Uncharacterized protei 98.3 0.00053 1.2E-08 63.8 23.2 160 155-320 201-379 (561)
280 KOG0280 Uncharacterized conser 98.3 3.9E-05 8.4E-10 66.7 14.9 139 154-295 93-248 (339)
281 PF07433 DUF1513: Protein of u 98.3 0.0014 3E-08 58.4 25.1 220 88-312 7-269 (305)
282 KOG0309 Conserved WD40 repeat- 98.3 3.5E-06 7.6E-11 81.0 9.3 200 81-292 20-235 (1081)
283 KOG1064 RAVE (regulator of V-A 98.3 5.9E-06 1.3E-10 86.2 11.4 159 128-299 2209-2376(2439)
284 TIGR03300 assembly_YfgL outer 98.3 0.00043 9.3E-09 64.5 23.3 185 99-302 147-351 (377)
285 PRK02888 nitrous-oxide reducta 98.2 0.0003 6.4E-09 68.2 21.4 214 93-318 200-449 (635)
286 KOG2695 WD40 repeat protein [G 98.2 7.1E-06 1.5E-10 72.6 9.4 154 88-252 214-381 (425)
287 COG4946 Uncharacterized protei 98.2 0.00029 6.3E-09 65.1 19.9 170 93-275 327-505 (668)
288 KOG0309 Conserved WD40 repeat- 98.2 8.3E-06 1.8E-10 78.5 10.1 198 82-290 111-340 (1081)
289 KOG1275 PAB-dependent poly(A) 98.1 8.1E-05 1.8E-09 73.5 15.1 177 97-287 147-340 (1118)
290 PF13360 PQQ_2: PQQ-like domai 98.1 0.0047 1E-07 53.2 25.4 198 107-318 4-218 (238)
291 PF00780 CNH: CNH domain; Int 98.1 0.0027 5.8E-08 56.4 23.6 197 87-298 37-264 (275)
292 PF06433 Me-amine-dh_H: Methyl 98.1 0.0072 1.6E-07 54.6 26.7 211 90-308 40-339 (342)
293 KOG2114 Vacuolar assembly/sort 98.1 0.0014 3.1E-08 64.6 22.4 221 87-319 27-272 (933)
294 PF08450 SGL: SMP-30/Gluconola 98.1 0.0062 1.3E-07 53.1 29.8 212 90-319 4-244 (246)
295 KOG2695 WD40 repeat protein [G 98.1 2.4E-05 5.2E-10 69.3 9.1 153 156-313 234-403 (425)
296 KOG2041 WD40 repeat protein [G 98.1 6.9E-05 1.5E-09 72.2 12.8 222 84-319 13-277 (1189)
297 PF11768 DUF3312: Protein of u 98.1 0.00053 1.1E-08 65.1 18.4 117 171-292 201-332 (545)
298 KOG1912 WD40 repeat protein [G 98.1 0.0005 1.1E-08 67.0 18.5 201 87-298 17-269 (1062)
299 TIGR03300 assembly_YfgL outer 98.0 0.001 2.2E-08 62.0 20.0 183 96-297 104-305 (377)
300 KOG2066 Vacuolar assembly/sort 98.0 0.00067 1.5E-08 66.4 18.6 154 82-247 55-233 (846)
301 PF04762 IKI3: IKI3 family; I 98.0 0.0027 5.8E-08 65.8 24.3 194 87-290 211-457 (928)
302 PF00400 WD40: WD domain, G-be 98.0 1.3E-05 2.9E-10 48.6 4.8 32 81-112 7-39 (39)
303 KOG0280 Uncharacterized conser 98.0 0.00034 7.5E-09 60.9 14.7 191 88-292 124-336 (339)
304 smart00320 WD40 WD40 repeats. 98.0 2.1E-05 4.6E-10 45.9 5.2 37 250-287 4-40 (40)
305 KOG4190 Uncharacterized conser 98.0 4.2E-05 9.1E-10 71.6 9.1 204 82-298 732-957 (1034)
306 KOG2041 WD40 repeat protein [G 97.9 0.00055 1.2E-08 66.2 16.4 226 81-317 67-323 (1189)
307 PF04053 Coatomer_WDAD: Coatom 97.9 0.0068 1.5E-07 57.6 22.5 162 87-269 34-207 (443)
308 PF04841 Vps16_N: Vps16, N-ter 97.9 0.0072 1.6E-07 57.0 22.4 42 258-300 216-257 (410)
309 KOG1912 WD40 repeat protein [G 97.8 0.00071 1.5E-08 66.0 15.1 220 83-312 53-387 (1062)
310 KOG4532 WD40-like repeat conta 97.8 0.00084 1.8E-08 57.9 13.5 135 154-292 92-236 (344)
311 KOG4640 Anaphase-promoting com 97.8 0.00018 3.9E-09 68.5 9.8 91 219-311 23-114 (665)
312 KOG2066 Vacuolar assembly/sort 97.7 0.0015 3.2E-08 64.1 14.5 180 86-290 40-234 (846)
313 KOG1409 Uncharacterized conser 97.6 0.0067 1.4E-07 54.2 17.1 202 78-293 17-231 (404)
314 KOG2314 Translation initiation 97.6 0.011 2.4E-07 55.9 18.8 222 90-321 310-558 (698)
315 KOG1334 WD40 repeat protein [G 97.6 0.00031 6.7E-09 65.0 8.0 156 126-291 141-314 (559)
316 PRK11138 outer membrane biogen 97.4 0.056 1.2E-06 50.7 22.0 187 97-298 69-283 (394)
317 PF08553 VID27: VID27 cytoplas 97.4 0.0062 1.3E-07 61.3 15.9 132 154-289 502-647 (794)
318 PF07433 DUF1513: Protein of u 97.4 0.053 1.1E-06 48.5 20.1 181 91-281 56-278 (305)
319 PRK11138 outer membrane biogen 97.4 0.05 1.1E-06 51.0 21.4 182 100-300 163-364 (394)
320 PF05096 Glu_cyclase_2: Glutam 97.4 0.077 1.7E-06 46.5 22.7 118 86-213 45-168 (264)
321 KOG1645 RING-finger-containing 97.4 0.0071 1.5E-07 55.1 14.3 228 81-318 189-450 (463)
322 KOG1920 IkappaB kinase complex 97.4 0.031 6.7E-07 57.6 20.0 193 86-291 69-324 (1265)
323 KOG1275 PAB-dependent poly(A) 97.3 0.0019 4E-08 64.2 10.5 147 95-246 185-341 (1118)
324 PF11768 DUF3312: Protein of u 97.3 0.013 2.9E-07 55.9 15.4 122 195-319 185-318 (545)
325 PF08553 VID27: VID27 cytoplas 97.3 0.0044 9.5E-08 62.3 12.8 120 194-320 504-639 (794)
326 KOG3914 WD repeat protein WDR4 97.2 0.0068 1.5E-07 55.0 12.6 79 236-315 129-207 (390)
327 COG0823 TolB Periplasmic compo 97.2 0.028 6.1E-07 53.2 17.3 178 131-316 196-385 (425)
328 KOG2395 Protein involved in va 97.2 0.0092 2E-07 56.3 13.2 131 155-289 355-500 (644)
329 PRK02888 nitrous-oxide reducta 97.1 0.13 2.8E-06 50.4 20.5 146 156-312 215-386 (635)
330 PF08450 SGL: SMP-30/Gluconola 97.0 0.2 4.4E-06 43.5 25.9 146 133-289 5-164 (246)
331 PF12894 Apc4_WD40: Anaphase-p 96.9 0.0031 6.8E-08 39.9 5.1 35 258-294 11-45 (47)
332 KOG3621 WD40 repeat-containing 96.9 0.007 1.5E-07 58.7 9.7 110 178-290 38-155 (726)
333 COG0823 TolB Periplasmic compo 96.8 0.11 2.3E-06 49.3 17.3 121 195-319 219-344 (425)
334 PF15492 Nbas_N: Neuroblastoma 96.8 0.15 3.2E-06 44.7 16.6 153 87-248 45-260 (282)
335 COG5170 CDC55 Serine/threonine 96.8 0.017 3.6E-07 51.1 10.8 158 81-245 168-365 (460)
336 KOG4649 PQQ (pyrrolo-quinoline 96.7 0.33 7.2E-06 42.2 20.4 148 97-257 23-175 (354)
337 cd00216 PQQ_DH Dehydrogenases 96.7 0.61 1.3E-05 45.2 21.6 191 96-298 61-328 (488)
338 PF14783 BBS2_Mid: Ciliary BBS 96.7 0.091 2E-06 39.6 12.4 86 154-243 23-110 (111)
339 PF00930 DPPIV_N: Dipeptidyl p 96.7 0.54 1.2E-05 43.4 23.4 229 86-317 43-344 (353)
340 PF08596 Lgl_C: Lethal giant l 96.6 0.35 7.6E-06 45.4 18.8 195 82-288 83-334 (395)
341 KOG1920 IkappaB kinase complex 96.6 0.21 4.5E-06 51.8 17.9 180 128-317 69-306 (1265)
342 PF03178 CPSF_A: CPSF A subuni 96.6 0.56 1.2E-05 42.6 24.6 174 97-284 42-260 (321)
343 PF04053 Coatomer_WDAD: Coatom 96.6 0.13 2.8E-06 48.9 15.8 133 97-246 117-261 (443)
344 COG3391 Uncharacterized conser 96.6 0.67 1.5E-05 43.3 25.9 207 88-302 76-296 (381)
345 PF14783 BBS2_Mid: Ciliary BBS 96.6 0.13 2.8E-06 38.8 12.5 89 186-284 16-109 (111)
346 KOG4649 PQQ (pyrrolo-quinoline 96.4 0.26 5.6E-06 42.8 15.2 105 194-304 33-138 (354)
347 KOG0882 Cyclophilin-related pe 96.4 0.051 1.1E-06 50.4 11.6 155 126-289 8-174 (558)
348 PF14583 Pectate_lyase22: Olig 96.4 0.81 1.8E-05 42.4 20.8 59 261-319 285-369 (386)
349 KOG2114 Vacuolar assembly/sort 96.4 0.26 5.5E-06 49.4 16.6 148 132-291 28-203 (933)
350 KOG1832 HIV-1 Vpr-binding prot 96.3 0.0041 8.9E-08 61.8 3.9 170 126-315 1100-1281(1516)
351 smart00320 WD40 WD40 repeats. 96.3 0.0087 1.9E-07 34.1 4.0 30 83-112 10-40 (40)
352 KOG4640 Anaphase-promoting com 96.2 0.033 7.2E-07 53.6 9.5 92 86-186 21-116 (665)
353 KOG2079 Vacuolar assembly/sort 96.0 0.017 3.7E-07 58.7 6.6 71 229-301 100-172 (1206)
354 PF05694 SBP56: 56kDa selenium 95.9 1.5 3.2E-05 41.2 22.9 223 96-321 86-394 (461)
355 PF00780 CNH: CNH domain; Int 95.9 1.1 2.3E-05 39.6 22.3 140 95-252 5-170 (275)
356 COG3386 Gluconolactonase [Carb 95.9 0.91 2E-05 41.1 17.0 134 155-289 46-193 (307)
357 COG3391 Uncharacterized conser 95.9 1.5 3.3E-05 41.0 26.4 176 133-318 79-270 (381)
358 KOG1897 Damage-specific DNA bi 95.8 2.7 5.8E-05 43.2 20.9 195 91-290 676-899 (1096)
359 KOG1008 Uncharacterized conser 95.8 0.0025 5.5E-08 61.1 0.1 195 86-290 57-276 (783)
360 PF12894 Apc4_WD40: Anaphase-p 95.6 0.036 7.7E-07 35.1 4.9 29 85-113 11-40 (47)
361 KOG1645 RING-finger-containing 95.5 0.05 1.1E-06 49.7 7.1 92 196-291 175-268 (463)
362 PF00930 DPPIV_N: Dipeptidyl p 95.5 0.069 1.5E-06 49.4 8.4 81 238-320 22-120 (353)
363 KOG3621 WD40 repeat-containing 95.3 0.61 1.3E-05 45.8 14.2 34 82-115 121-155 (726)
364 KOG4714 Nucleoporin [Nuclear s 95.3 0.29 6.3E-06 42.4 10.7 101 96-203 143-255 (319)
365 COG3490 Uncharacterized protei 95.1 0.68 1.5E-05 40.9 12.6 41 256-296 277-317 (366)
366 PF10313 DUF2415: Uncharacteri 95.1 0.11 2.3E-06 32.1 5.5 32 259-291 1-35 (43)
367 COG3823 Glutamine cyclotransfe 95.1 0.96 2.1E-05 38.2 12.8 108 96-210 55-166 (262)
368 PF14761 HPS3_N: Hermansky-Pud 95.1 1.3 2.8E-05 37.6 13.9 113 176-293 18-167 (215)
369 PF06977 SdiA-regulated: SdiA- 95.1 2.2 4.7E-05 37.4 23.4 188 87-286 23-247 (248)
370 PF08596 Lgl_C: Lethal giant l 95.0 3.2 6.8E-05 39.1 24.6 217 87-317 3-323 (395)
371 PF09826 Beta_propel: Beta pro 95.0 3.8 8.3E-05 40.0 21.0 101 95-199 20-144 (521)
372 KOG3617 WD40 and TPR repeat-co 95.0 0.051 1.1E-06 54.2 6.0 113 128-247 16-131 (1416)
373 KOG1897 Damage-specific DNA bi 94.8 3 6.5E-05 42.8 17.6 197 87-288 716-941 (1096)
374 PF05096 Glu_cyclase_2: Glutam 94.7 2.8 6E-05 36.9 21.8 136 155-298 67-212 (264)
375 PF14583 Pectate_lyase22: Olig 94.6 1.9 4.2E-05 39.9 15.0 177 134-317 42-254 (386)
376 cd00216 PQQ_DH Dehydrogenases 94.5 5 0.00011 38.9 26.1 48 270-318 406-456 (488)
377 PF05694 SBP56: 56kDa selenium 94.4 4.6 0.0001 38.1 18.6 153 94-248 138-343 (461)
378 PHA02713 hypothetical protein; 94.3 5.5 0.00012 39.3 18.6 60 229-292 465-536 (557)
379 TIGR03075 PQQ_enz_alc_DH PQQ-d 94.2 6 0.00013 38.7 22.3 192 96-295 69-339 (527)
380 KOG2395 Protein involved in va 94.1 0.68 1.5E-05 44.2 11.0 144 96-245 344-498 (644)
381 KOG1898 Splicing factor 3b, su 94.0 3.3 7.1E-05 42.9 16.1 129 154-289 910-1046(1205)
382 KOG2444 WD40 repeat protein [G 94.0 0.15 3.3E-06 43.3 5.9 135 154-291 38-179 (238)
383 TIGR02276 beta_rpt_yvtn 40-res 93.9 0.41 8.9E-06 28.8 6.5 40 268-308 1-41 (42)
384 KOG2079 Vacuolar assembly/sort 93.7 0.32 6.9E-06 49.9 8.5 106 178-289 92-203 (1206)
385 KOG1008 Uncharacterized conser 93.7 0.0084 1.8E-07 57.7 -2.3 157 83-247 100-275 (783)
386 PF14727 PHTB1_N: PTHB1 N-term 93.3 6.3 0.00014 37.3 16.0 133 154-288 45-203 (418)
387 PRK13616 lipoprotein LpqB; Pro 93.3 9.5 0.00021 37.9 19.9 179 87-275 351-556 (591)
388 KOG3617 WD40 and TPR repeat-co 93.1 0.096 2.1E-06 52.3 3.8 103 181-289 21-131 (1416)
389 PHA03098 kelch-like protein; P 92.7 11 0.00023 36.9 18.5 130 156-292 358-514 (534)
390 KOG1900 Nuclear pore complex, 92.7 2.5 5.4E-05 44.7 13.2 134 154-290 97-273 (1311)
391 PF02897 Peptidase_S9_N: Proly 92.5 9.3 0.0002 35.9 25.9 207 87-298 125-366 (414)
392 PF10168 Nup88: Nuclear pore c 92.4 14 0.0003 37.6 19.4 74 87-167 86-182 (717)
393 KOG4441 Proteins containing BT 92.1 8.7 0.00019 38.1 15.9 130 155-291 395-548 (571)
394 KOG1916 Nuclear protein, conta 92.0 0.088 1.9E-06 52.9 1.9 59 229-289 196-265 (1283)
395 PF12234 Rav1p_C: RAVE protein 91.6 4.7 0.0001 40.0 13.4 99 186-288 41-155 (631)
396 smart00036 CNH Domain found in 91.3 11 0.00023 34.1 22.7 64 93-163 9-72 (302)
397 PRK13616 lipoprotein LpqB; Pro 91.1 3.7 8.1E-05 40.7 12.3 94 219-318 354-465 (591)
398 COG5167 VID27 Protein involved 90.8 10 0.00022 36.5 13.9 131 154-289 488-632 (776)
399 PF15390 DUF4613: Domain of un 90.7 18 0.00038 35.5 18.7 144 176-321 57-222 (671)
400 PF14870 PSII_BNR: Photosynthe 90.7 13 0.00027 33.7 20.3 187 85-287 16-213 (302)
401 PF11715 Nup160: Nucleoporin N 90.3 0.69 1.5E-05 45.4 6.5 41 259-300 215-259 (547)
402 PF04841 Vps16_N: Vps16, N-ter 89.8 18 0.00039 34.2 20.0 29 86-114 81-109 (410)
403 TIGR03074 PQQ_membr_DH membran 89.7 26 0.00057 36.0 23.8 143 154-297 268-485 (764)
404 PF12234 Rav1p_C: RAVE protein 89.6 11 0.00024 37.5 14.0 104 91-201 35-155 (631)
405 TIGR03075 PQQ_enz_alc_DH PQQ-d 89.6 2.4 5.2E-05 41.5 9.5 50 269-319 471-523 (527)
406 PF14781 BBS2_N: Ciliary BBSom 89.5 8.6 0.00019 30.1 12.9 113 89-210 2-133 (136)
407 COG3386 Gluconolactonase [Carb 88.7 18 0.00039 32.7 23.4 194 92-300 31-253 (307)
408 PF10168 Nup88: Nuclear pore c 88.0 13 0.00028 37.8 13.5 35 257-292 145-182 (717)
409 PF06977 SdiA-regulated: SdiA- 87.5 19 0.00041 31.5 20.5 175 128-314 22-235 (248)
410 PF15390 DUF4613: Domain of un 87.2 32 0.00069 33.8 20.1 96 90-193 117-221 (671)
411 PF10214 Rrn6: RNA polymerase 87.0 40 0.00087 34.8 19.4 112 84-203 144-277 (765)
412 PF12355 Dscam_C: Down syndrom 87.0 0.42 9.1E-06 35.3 1.8 11 12-22 63-73 (124)
413 PHA02790 Kelch-like protein; P 86.7 32 0.00069 33.3 18.8 140 139-291 318-472 (480)
414 PF07569 Hira: TUP1-like enhan 85.5 7.7 0.00017 33.3 9.1 67 220-291 16-97 (219)
415 COG3490 Uncharacterized protei 85.4 18 0.00039 32.3 11.2 109 166-276 58-179 (366)
416 KOG2444 WD40 repeat protein [G 85.2 5.1 0.00011 34.3 7.6 82 235-318 76-163 (238)
417 PHA02713 hypothetical protein; 85.2 11 0.00024 37.2 11.3 90 156-250 432-536 (557)
418 PF14655 RAB3GAP2_N: Rab3 GTPa 84.3 13 0.00028 35.2 10.7 39 85-123 307-346 (415)
419 TIGR02604 Piru_Ver_Nterm putat 83.9 36 0.00078 31.5 17.5 111 177-287 73-212 (367)
420 PF03088 Str_synth: Strictosid 83.4 5.3 0.00012 28.9 6.1 53 234-286 32-85 (89)
421 PF10313 DUF2415: Uncharacteri 83.2 4.1 8.9E-05 25.1 4.6 30 86-115 1-34 (43)
422 COG5276 Uncharacterized conser 83.1 35 0.00075 30.7 19.4 141 168-317 79-230 (370)
423 KOG1896 mRNA cleavage and poly 83.0 23 0.0005 37.6 12.4 130 155-289 1064-1213(1366)
424 KOG2280 Vacuolar assembly/sort 82.3 60 0.0013 32.9 15.4 42 258-300 216-257 (829)
425 PF06433 Me-amine-dh_H: Methyl 81.9 42 0.0009 30.8 17.5 176 107-292 18-216 (342)
426 PRK10115 protease 2; Provision 81.9 63 0.0014 32.9 27.7 202 87-297 128-353 (686)
427 PF07676 PD40: WD40-like Beta 81.0 5.8 0.00013 23.3 4.8 30 256-286 6-38 (39)
428 PF07569 Hira: TUP1-like enhan 80.7 15 0.00033 31.4 9.1 32 91-122 16-48 (219)
429 PF12657 TFIIIC_delta: Transcr 80.3 10 0.00022 31.1 7.7 24 88-112 7-30 (173)
430 KOG2377 Uncharacterized conser 80.3 26 0.00056 33.4 10.7 61 257-319 65-130 (657)
431 COG5167 VID27 Protein involved 80.0 18 0.00039 34.9 9.7 118 195-319 491-623 (776)
432 PF14655 RAB3GAP2_N: Rab3 GTPa 79.3 58 0.0013 30.8 23.1 50 254-305 303-352 (415)
433 KOG2675 Adenylate cyclase-asso 78.1 2.2 4.8E-05 39.7 3.2 13 188-200 383-395 (480)
434 KOG4499 Ca2+-binding protein R 77.8 37 0.00081 29.5 10.2 91 89-186 161-264 (310)
435 PF08728 CRT10: CRT10; InterP 77.4 58 0.0013 33.1 13.0 81 226-309 112-219 (717)
436 KOG4441 Proteins containing BT 77.2 73 0.0016 31.6 13.8 108 95-204 379-501 (571)
437 PF12657 TFIIIC_delta: Transcr 76.3 22 0.00047 29.1 8.5 31 259-290 86-122 (173)
438 COG5276 Uncharacterized conser 75.6 61 0.0013 29.2 18.6 166 138-318 95-273 (370)
439 KOG4460 Nuclear pore complex, 75.1 57 0.0012 31.7 11.6 27 87-113 105-131 (741)
440 KOG4327 mRNA splicing protein 74.5 2.5 5.5E-05 34.9 2.3 22 8-29 162-183 (218)
441 KOG2247 WD40 repeat-containing 74.3 0.35 7.5E-06 45.7 -3.0 122 154-281 54-181 (615)
442 PF10395 Utp8: Utp8 family; I 73.7 1.1E+02 0.0023 31.0 16.7 158 86-250 130-308 (670)
443 smart00564 PQQ beta-propeller 73.5 9.3 0.0002 21.3 4.1 25 272-297 8-32 (33)
444 PF01011 PQQ: PQQ enzyme repea 73.2 11 0.00024 22.2 4.4 28 274-302 4-31 (38)
445 TIGR03074 PQQ_membr_DH membran 72.8 1.2E+02 0.0026 31.3 15.3 21 279-300 335-355 (764)
446 PF01436 NHL: NHL repeat; Int 72.6 9.8 0.00021 20.8 3.8 25 261-286 4-28 (28)
447 PF02897 Peptidase_S9_N: Proly 71.8 88 0.0019 29.3 25.3 197 90-294 174-409 (414)
448 KOG2377 Uncharacterized conser 71.6 98 0.0021 29.7 12.3 107 89-202 26-140 (657)
449 PF14781 BBS2_N: Ciliary BBSom 71.4 48 0.001 26.0 12.4 52 155-206 19-85 (136)
450 PF11715 Nup160: Nucleoporin N 70.7 12 0.00025 36.8 6.5 30 138-174 229-258 (547)
451 PF10647 Gmad1: Lipoprotein Lp 70.1 75 0.0016 27.7 12.3 122 193-319 1-130 (253)
452 TIGR02276 beta_rpt_yvtn 40-res 69.2 21 0.00045 21.0 6.1 29 155-183 13-41 (42)
453 KOG4460 Nuclear pore complex, 69.1 74 0.0016 31.0 10.9 34 260-294 167-203 (741)
454 KOG4499 Ca2+-binding protein R 67.2 86 0.0019 27.3 10.7 91 221-313 162-264 (310)
455 PF12341 DUF3639: Protein of u 66.9 15 0.00032 20.2 3.6 24 177-200 3-27 (27)
456 KOG1900 Nuclear pore complex, 66.4 46 0.00099 35.8 9.7 96 187-288 92-204 (1311)
457 COG4880 Secreted protein conta 66.1 1.2E+02 0.0027 28.8 13.6 69 175-247 427-503 (603)
458 KOG2109 WD40 repeat protein [G 66.0 7.6 0.00016 38.3 3.9 49 241-289 297-346 (788)
459 KOG3630 Nuclear pore complex, 64.2 40 0.00087 35.8 8.6 52 235-287 174-226 (1405)
460 PF08801 Nucleoporin_N: Nup133 64.0 1.3E+02 0.0028 28.3 14.2 31 259-290 190-220 (422)
461 PF08728 CRT10: CRT10; InterP 63.9 1.8E+02 0.0038 29.8 14.4 61 226-288 175-245 (717)
462 PF01731 Arylesterase: Arylest 62.2 56 0.0012 23.5 6.9 30 259-289 54-84 (86)
463 PRK13684 Ycf48-like protein; P 61.3 1.3E+02 0.0029 27.4 23.8 72 219-295 175-249 (334)
464 COG5308 NUP170 Nuclear pore co 60.2 65 0.0014 33.5 9.1 132 154-290 100-276 (1263)
465 PHA03098 kelch-like protein; P 60.0 1.7E+02 0.0038 28.4 17.9 108 95-204 341-466 (534)
466 TIGR02604 Piru_Ver_Nterm putat 57.3 1.6E+02 0.0035 27.2 14.9 57 258-316 123-199 (367)
467 PF07995 GSDH: Glucose / Sorbo 56.1 76 0.0016 28.9 8.6 31 260-293 3-33 (331)
468 KOG2280 Vacuolar assembly/sort 55.6 39 0.00085 34.1 6.7 89 195-290 65-157 (829)
469 KOG3630 Nuclear pore complex, 55.5 1.6E+02 0.0035 31.6 11.2 137 131-276 104-261 (1405)
470 COG4590 ABC-type uncharacteriz 54.5 78 0.0017 30.3 8.2 55 236-292 335-389 (733)
471 COG3292 Predicted periplasmic 54.5 2.3E+02 0.005 28.1 16.0 136 157-297 355-499 (671)
472 PRK13684 Ycf48-like protein; P 53.9 1.8E+02 0.0038 26.6 16.4 149 86-245 173-329 (334)
473 KOG1898 Splicing factor 3b, su 53.5 3.1E+02 0.0067 29.3 15.1 87 156-245 954-1046(1205)
474 PLN00033 photosystem II stabil 53.4 2E+02 0.0044 27.1 22.8 104 175-281 280-392 (398)
475 PF09826 Beta_propel: Beta pro 53.1 1.3E+02 0.0028 29.5 10.0 48 137-192 20-70 (521)
476 PF05308 Mito_fiss_reg: Mitoch 51.8 16 0.00035 32.1 3.2 6 36-41 211-216 (253)
477 PF14761 HPS3_N: Hermansky-Pud 49.6 1.7E+02 0.0036 25.1 13.1 62 99-161 31-92 (215)
478 COG1770 PtrB Protease II [Amin 48.5 3E+02 0.0066 27.7 24.1 200 87-295 130-354 (682)
479 TIGR02608 delta_60_rpt delta-6 48.3 58 0.0013 21.2 4.6 19 260-278 2-20 (55)
480 KOG3616 Selective LIM binding 47.5 1.2E+02 0.0026 31.0 8.6 64 130-200 17-81 (1636)
481 KOG3616 Selective LIM binding 46.2 42 0.0009 34.1 5.3 35 258-293 14-48 (1636)
482 PF10214 Rrn6: RNA polymerase 45.0 3.7E+02 0.0081 27.8 17.7 116 174-293 78-236 (765)
483 KOG2714 SETA binding protein S 44.9 1.5E+02 0.0033 28.0 8.4 108 154-290 243-372 (465)
484 COG5308 NUP170 Nuclear pore co 44.7 83 0.0018 32.7 7.2 97 187-289 95-209 (1263)
485 PRK12634 flgD flagellar basal 44.6 1.4E+02 0.0031 25.6 7.9 19 258-276 189-207 (221)
486 KOG2883 NIPSNAP1 protein [Func 44.1 12 0.00026 31.7 1.2 26 5-49 136-161 (253)
487 PF12768 Rax2: Cortical protei 43.5 61 0.0013 28.9 5.7 53 239-292 16-75 (281)
488 PHA02790 Kelch-like protein; P 43.5 3.1E+02 0.0067 26.4 16.8 105 94-204 316-425 (480)
489 TIGR03606 non_repeat_PQQ dehyd 43.1 3.1E+02 0.0068 26.4 17.7 19 256-275 228-246 (454)
490 PRK10115 protease 2; Provision 42.3 3.9E+02 0.0084 27.2 25.8 196 89-292 175-397 (686)
491 PF01213 CAP_N: Adenylate cycl 41.8 8.6 0.00019 34.8 0.0 12 12-24 234-245 (312)
492 PF07250 Glyoxal_oxid_N: Glyox 41.2 1.9E+02 0.0042 25.2 8.2 115 92-212 73-207 (243)
493 TIGR03118 PEPCTERM_chp_1 conse 39.9 2.9E+02 0.0064 25.1 23.2 68 235-303 218-293 (336)
494 KOG1896 mRNA cleavage and poly 39.8 5.3E+02 0.012 28.1 12.4 36 236-271 98-148 (1366)
495 PRK12633 flgD flagellar basal 39.3 1.9E+02 0.0041 25.0 7.9 87 195-287 132-223 (230)
496 PF08954 DUF1900: Domain of un 39.1 1.3E+02 0.0028 23.7 6.2 71 219-292 13-87 (136)
497 PF07250 Glyoxal_oxid_N: Glyox 38.7 1.2E+02 0.0027 26.4 6.7 69 227-298 128-206 (243)
498 KOG2675 Adenylate cyclase-asso 37.8 28 0.00061 32.7 2.6 34 1-34 227-265 (480)
499 COG5290 IkappaB kinase complex 37.8 2.3E+02 0.005 29.3 8.9 157 89-252 205-371 (1243)
500 KOG1983 Tomosyn and related SN 37.6 5.5E+02 0.012 27.6 13.9 194 91-295 41-270 (993)
No 1
>KOG2111 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=100.00 E-value=3.7e-35 Score=251.14 Aligned_cols=232 Identities=58% Similarity=0.938 Sum_probs=215.6
Q ss_pred CeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCC
Q 020784 87 TLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQS 166 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~ 166 (321)
...+++|++|-..|++|.+.|+|||++++.++...+.+ +.+++..+++.+..|++++++|+....|..++|.|||....
T Consensus 7 ~~lsvs~NQD~ScFava~~~Gfriyn~~P~ke~~~r~~-~~~G~~~veMLfR~N~laLVGGg~~pky~pNkviIWDD~k~ 85 (346)
T KOG2111|consen 7 KTLSVSFNQDHSCFAVATDTGFRIYNCDPFKESASRQF-IDGGFKIVEMLFRSNYLALVGGGSRPKYPPNKVIIWDDLKE 85 (346)
T ss_pred ceeEEEEccCCceEEEEecCceEEEecCchhhhhhhcc-ccCchhhhhHhhhhceEEEecCCCCCCCCCceEEEEecccC
Confidence 56679999999999999999999999999988777776 45669999999999999999999888889999999999899
Q ss_pred cEEEEEeeCCceeEEEEeCCeEEEEECCEEEEEEcC-CcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEe
Q 020784 167 RCIGELSFRSEVRSVKLRRDRIIVVLEQKIFVYNFA-DLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEH 245 (321)
Q Consensus 167 ~~~~~~~~~~~v~~v~~~~~~~~~~~~~~I~iwd~~-~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d 245 (321)
+++.++.+.++|.+|.+.+++++++..++|++|.+. +.++++.+++..+|.+.|++++..+..+||+.|..-|.|.|.|
T Consensus 86 ~~i~el~f~~~I~~V~l~r~riVvvl~~~I~VytF~~n~k~l~~~et~~NPkGlC~~~~~~~k~~LafPg~k~GqvQi~d 165 (346)
T KOG2111|consen 86 RCIIELSFNSEIKAVKLRRDRIVVVLENKIYVYTFPDNPKLLHVIETRSNPKGLCSLCPTSNKSLLAFPGFKTGQVQIVD 165 (346)
T ss_pred cEEEEEEeccceeeEEEcCCeEEEEecCeEEEEEcCCChhheeeeecccCCCceEeecCCCCceEEEcCCCccceEEEEE
Confidence 999999999999999999999999999999999996 7899999999999999999999999999999999999999988
Q ss_pred eCCcce---EEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeE---EEeecCceEEEee
Q 020784 246 YASKRT---KFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQS---GLWLSSAWLRVLR 319 (321)
Q Consensus 246 ~~~~~~---~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~---~~s~d~~~la~~~ 319 (321)
+..... ..+.+|.+.|.|++++-+|.++||+|..||+|||||..+|++++++++|.+.+.+ +||++++||||++
T Consensus 166 L~~~~~~~p~~I~AH~s~Iacv~Ln~~Gt~vATaStkGTLIRIFdt~~g~~l~E~RRG~d~A~iy~iaFSp~~s~LavsS 245 (346)
T KOG2111|consen 166 LASTKPNAPSIINAHDSDIACVALNLQGTLVATASTKGTLIRIFDTEDGTLLQELRRGVDRADIYCIAFSPNSSWLAVSS 245 (346)
T ss_pred hhhcCcCCceEEEcccCceeEEEEcCCccEEEEeccCcEEEEEEEcCCCcEeeeeecCCchheEEEEEeCCCccEEEEEc
Confidence 775544 7899999999999999999999999999999999999999999999999987655 8889999999986
No 2
>KOG2110 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=100.00 E-value=2.6e-31 Score=231.57 Aligned_cols=226 Identities=35% Similarity=0.603 Sum_probs=204.3
Q ss_pred CCeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCC
Q 020784 86 PTLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQ 165 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~ 165 (321)
..+..+.|++|+..|..|+.+|.++|++++....+... .+.+.+|++.|+..++++++-. ..+.+++.+.++
T Consensus 6 ~ti~~~~~Nqd~~~lsvGs~~Gyk~~~~~~~~k~~~~~---~~~~~IvEmLFSSSLvaiV~~~-----qpr~Lkv~~~Kk 77 (391)
T KOG2110|consen 6 PTINFIGFNQDSTLLSVGSKDGYKIFSCSPFEKCFSKD---TEGVSIVEMLFSSSLVAIVSIK-----QPRKLKVVHFKK 77 (391)
T ss_pred cceeeeeeccceeEEEccCCCceeEEecCchHHhhccc---CCCeEEEEeecccceeEEEecC-----CCceEEEEEccc
Confidence 36788889999999999999999999999887755444 5789999999999999999964 458899999999
Q ss_pred CcEEEEEeeCCceeEEEEeCCeEEEEECCEEEEEEcCCcEEEEEEecc-CCCCceEEEeeCCCceEEEeecCC-CCcEEE
Q 020784 166 SRCIGELSFRSEVRSVKLRRDRIIVVLEQKIFVYNFADLKLLHQIETI-ANPKGLCAVSQGVGSLVLVCPGLQ-KGQVRV 243 (321)
Q Consensus 166 ~~~~~~~~~~~~v~~v~~~~~~~~~~~~~~I~iwd~~~~~~~~~l~~~-~~~~~~~~~s~~~d~~~la~sGs~-dg~V~i 243 (321)
+..+.++.+..+|.+|.+++++++++....|.|||++++++++++... .++.++|+++++.++.++|+.|+. .|.|.+
T Consensus 78 ~~~ICe~~fpt~IL~VrmNr~RLvV~Lee~IyIydI~~MklLhTI~t~~~n~~gl~AlS~n~~n~ylAyp~s~t~GdV~l 157 (391)
T KOG2110|consen 78 KTTICEIFFPTSILAVRMNRKRLVVCLEESIYIYDIKDMKLLHTIETTPPNPKGLCALSPNNANCYLAYPGSTTSGDVVL 157 (391)
T ss_pred CceEEEEecCCceEEEEEccceEEEEEcccEEEEecccceeehhhhccCCCccceEeeccCCCCceEEecCCCCCceEEE
Confidence 999999999999999999999999999999999999999999999886 788899999999999999998765 578999
Q ss_pred EeeCC-cceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeE---EEeecCceEEEee
Q 020784 244 EHYAS-KRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQS---GLWLSSAWLRVLR 319 (321)
Q Consensus 244 ~d~~~-~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~---~~s~d~~~la~~~ 319 (321)
||..+ ++..++.+|++.+-+++|+++|.+|||+|+.||+||||.+.+|+.+++|++|...+.+ +|++|++||++.+
T Consensus 158 ~d~~nl~~v~~I~aH~~~lAalafs~~G~llATASeKGTVIRVf~v~~G~kl~eFRRG~~~~~IySL~Fs~ds~~L~~sS 237 (391)
T KOG2110|consen 158 FDTINLQPVNTINAHKGPLAALAFSPDGTLLATASEKGTVIRVFSVPEGQKLYEFRRGTYPVSIYSLSFSPDSQFLAASS 237 (391)
T ss_pred EEcccceeeeEEEecCCceeEEEECCCCCEEEEeccCceEEEEEEcCCccEeeeeeCCceeeEEEEEEECCCCCeEEEec
Confidence 99765 5577899999999999999999999999999999999999999999999999886554 7788999998864
No 3
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=100.00 E-value=1.1e-31 Score=234.50 Aligned_cols=232 Identities=16% Similarity=0.155 Sum_probs=188.1
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCC-cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCC----------
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDH-GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPD---------- 150 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~-gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~---------- 150 (321)
.+|.+.|.|++|+|+|..||+|+.| ++|+||+++....+.... |.+.|.+++|+|++..+|..+-...
T Consensus 112 ~GH~e~Vl~~~fsp~g~~l~tGsGD~TvR~WD~~TeTp~~t~Kg-H~~WVlcvawsPDgk~iASG~~dg~I~lwdpktg~ 190 (480)
T KOG0271|consen 112 AGHGEAVLSVQFSPTGSRLVTGSGDTTVRLWDLDTETPLFTCKG-HKNWVLCVAWSPDGKKIASGSKDGSIRLWDPKTGQ 190 (480)
T ss_pred CCCCCcEEEEEecCCCceEEecCCCceEEeeccCCCCcceeecC-CccEEEEEEECCCcchhhccccCCeEEEecCCCCC
Confidence 5788999999999999999999875 599999998877666665 7889999999999988775442210
Q ss_pred -------------------------------CCCCCCcEEEEeCCCCcEEEEEeeCC-ceeEEEEeCCeEEEE-E-CCEE
Q 020784 151 -------------------------------PQYPLNKVMIWDDHQSRCIGELSFRS-EVRSVKLRRDRIIVV-L-EQKI 196 (321)
Q Consensus 151 -------------------------------~~~~d~~v~iWD~~~~~~~~~~~~~~-~v~~v~~~~~~~~~~-~-~~~I 196 (321)
..+-||+|+|||+..+.++..+..+. +|++++|..+.++.. + |++|
T Consensus 191 ~~g~~l~gH~K~It~Lawep~hl~p~~r~las~skDg~vrIWd~~~~~~~~~lsgHT~~VTCvrwGG~gliySgS~DrtI 270 (480)
T KOG0271|consen 191 QIGRALRGHKKWITALAWEPLHLVPPCRRLASSSKDGSVRIWDTKLGTCVRTLSGHTASVTCVRWGGEGLIYSGSQDRTI 270 (480)
T ss_pred cccccccCcccceeEEeecccccCCCccceecccCCCCEEEEEccCceEEEEeccCccceEEEEEcCCceEEecCCCceE
Confidence 02237899999999888888887665 899999997665544 3 4699
Q ss_pred EEEEcCCcEEEEEEeccCCCCc----------------------------------------------------------
Q 020784 197 FVYNFADLKLLHQIETIANPKG---------------------------------------------------------- 218 (321)
Q Consensus 197 ~iwd~~~~~~~~~l~~~~~~~~---------------------------------------------------------- 218 (321)
++|+...|++.+++++|.+.+.
T Consensus 271 kvw~a~dG~~~r~lkGHahwvN~lalsTdy~LRtgaf~~t~~~~~~~se~~~~Al~rY~~~~~~~~erlVSgsDd~tlfl 350 (480)
T KOG0271|consen 271 KVWRALDGKLCRELKGHAHWVNHLALSTDYVLRTGAFDHTGRKPKSFSEEQKKALERYEAVLKDSGERLVSGSDDFTLFL 350 (480)
T ss_pred EEEEccchhHHHhhcccchheeeeeccchhhhhccccccccccCCChHHHHHHHHHHHHHhhccCcceeEEecCCceEEE
Confidence 9999988888887777765543
Q ss_pred -------------------eEEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeC
Q 020784 219 -------------------LCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSST 278 (321)
Q Consensus 219 -------------------~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~ 278 (321)
+..+++.||+.++| |++.|+.|++|+..+++ +.+|++|-..|+.|+|+.|.++|++||.
T Consensus 351 W~p~~~kkpi~rmtgHq~lVn~V~fSPd~r~IA-SaSFDkSVkLW~g~tGk~lasfRGHv~~VYqvawsaDsRLlVS~Sk 429 (480)
T KOG0271|consen 351 WNPFKSKKPITRMTGHQALVNHVSFSPDGRYIA-SASFDKSVKLWDGRTGKFLASFRGHVAAVYQVAWSADSRLLVSGSK 429 (480)
T ss_pred ecccccccchhhhhchhhheeeEEECCCccEEE-EeecccceeeeeCCCcchhhhhhhccceeEEEEeccCccEEEEcCC
Confidence 33445556779998 69999999999998877 5699999999999999999999999999
Q ss_pred CCcEEEEEEcCCCcEEEEEeCCCcc--eeEEEeecCceEEE
Q 020784 279 KGTLVRIFNTLDGTLLQEECCPSIS--AQSGLWLSSAWLRV 317 (321)
Q Consensus 279 Dgt~IrIWd~~tg~~i~~~~~g~~~--~~~~~s~d~~~la~ 317 (321)
|.| +||||+++.++...+. ||.. ..+-.++||+.++-
T Consensus 430 DsT-LKvw~V~tkKl~~DLp-Gh~DEVf~vDwspDG~rV~s 468 (480)
T KOG0271|consen 430 DST-LKVWDVRTKKLKQDLP-GHADEVFAVDWSPDGQRVAS 468 (480)
T ss_pred Cce-EEEEEeeeeeecccCC-CCCceEEEEEecCCCceeec
Confidence 999 9999999999998884 5554 44466788887653
No 4
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=100.00 E-value=2.2e-32 Score=241.41 Aligned_cols=238 Identities=13% Similarity=0.038 Sum_probs=203.1
Q ss_pred CCCCCCCCCCcccCCCCCCeEEEEEcCC--CCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEE
Q 020784 69 YQMPLPSPAESTSSSPPPTLLHISFNQD--HGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALV 145 (321)
Q Consensus 69 ~~~~~~~~~~~~~~~~~~~V~~v~fs~d--g~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~ 145 (321)
.++.+......+.++|...|.++.|+|. +..||+|+.|| +++|++++...+...+. |...|..|++++++..++++
T Consensus 201 vW~~~~~~~~~~l~gH~~~v~~~~fhP~~~~~~lat~s~Dgtvklw~~~~e~~l~~l~g-H~~RVs~VafHPsG~~L~Ta 279 (459)
T KOG0272|consen 201 VWSVPQCNLLQTLRGHTSRVGAAVFHPVDSDLNLATASADGTVKLWKLSQETPLQDLEG-HLARVSRVAFHPSGKFLGTA 279 (459)
T ss_pred EeecCCcceeEEEeccccceeeEEEccCCCccceeeeccCCceeeeccCCCcchhhhhc-chhhheeeeecCCCceeeec
Confidence 4555555556667899999999999997 66899998866 88999988766656665 67889999999999999988
Q ss_pred eCCCCCCCCCCcEEEEeCCCCcEEEEEeeC-CceeEEEEeCCeEEEEEC---CEEEEEEcCCcEEEEEEeccCCCCceEE
Q 020784 146 GGGPDPQYPLNKVMIWDDHQSRCIGELSFR-SEVRSVKLRRDRIIVVLE---QKIFVYNFADLKLLHQIETIANPKGLCA 221 (321)
Q Consensus 146 sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~-~~v~~v~~~~~~~~~~~~---~~I~iwd~~~~~~~~~l~~~~~~~~~~~ 221 (321)
+ .|.+-++||++++..+.....+ ..|.++.|++++-+++++ ..-||||+++++++-.|.+|..++..++
T Consensus 280 s-------fD~tWRlWD~~tk~ElL~QEGHs~~v~~iaf~~DGSL~~tGGlD~~~RvWDlRtgr~im~L~gH~k~I~~V~ 352 (459)
T KOG0272|consen 280 S-------FDSTWRLWDLETKSELLLQEGHSKGVFSIAFQPDGSLAATGGLDSLGRVWDLRTGRCIMFLAGHIKEILSVA 352 (459)
T ss_pred c-------cccchhhcccccchhhHhhcccccccceeEecCCCceeeccCccchhheeecccCcEEEEecccccceeeEe
Confidence 8 7899999999998866555554 489999999998777764 4889999999999999999988877777
Q ss_pred EeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECC-CCCEEEEEeCCCcEEEEEEcCCCcEEEEEeC
Q 020784 222 VSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQ-DGQLLATSSTKGTLVRIFNTLDGTLLQEECC 299 (321)
Q Consensus 222 ~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafsp-dg~~las~S~Dgt~IrIWd~~tg~~i~~~~~ 299 (321)
|+|++ ..|| +|+.|++++|||+.... +.++.+|.+-|+.|+|+| .|.+|+|+|.|++ ++||...++.+++++ .
T Consensus 353 fsPNG--y~lA-Tgs~Dnt~kVWDLR~r~~ly~ipAH~nlVS~Vk~~p~~g~fL~TasyD~t-~kiWs~~~~~~~ksL-a 427 (459)
T KOG0272|consen 353 FSPNG--YHLA-TGSSDNTCKVWDLRMRSELYTIPAHSNLVSQVKYSPQEGYFLVTASYDNT-VKIWSTRTWSPLKSL-A 427 (459)
T ss_pred ECCCc--eEEe-ecCCCCcEEEeeecccccceecccccchhhheEecccCCeEEEEcccCcc-eeeecCCCcccchhh-c
Confidence 76654 7788 69999999999998755 779999999999999998 6899999999999 999999999999999 7
Q ss_pred CCcceeE--EEeecCceEEEee
Q 020784 300 PSISAQS--GLWLSSAWLRVLR 319 (321)
Q Consensus 300 g~~~~~~--~~s~d~~~la~~~ 319 (321)
||+..++ .++.||++++.+.
T Consensus 428 GHe~kV~s~Dis~d~~~i~t~s 449 (459)
T KOG0272|consen 428 GHEGKVISLDISPDSQAIATSS 449 (459)
T ss_pred CCccceEEEEeccCCceEEEec
Confidence 8887766 5689999998753
No 5
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=99.97 E-value=1.4e-30 Score=230.10 Aligned_cols=224 Identities=16% Similarity=0.112 Sum_probs=188.9
Q ss_pred CCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCC--CeEEEEeCCCCCCCCCCcEE
Q 020784 83 SPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRC--NILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~--~~~~~~sg~~~~~~~d~~v~ 159 (321)
+...+|..|.|+.|++.||||+-.| ++||+..+...+..... |...+..+.|+|.. ..+++++ .||+|+
T Consensus 173 gd~rPis~~~fS~ds~~laT~swsG~~kvW~~~~~~~~~~l~g-H~~~v~~~~fhP~~~~~~lat~s-------~Dgtvk 244 (459)
T KOG0272|consen 173 GDTRPISGCSFSRDSKHLATGSWSGLVKVWSVPQCNLLQTLRG-HTSRVGAAVFHPVDSDLNLATAS-------ADGTVK 244 (459)
T ss_pred cCCCcceeeEeecCCCeEEEeecCCceeEeecCCcceeEEEec-cccceeeEEEccCCCccceeeec-------cCCcee
Confidence 4456999999999999999999876 67999988876655554 78899999999874 3556665 789999
Q ss_pred EEeCCCCcEEEEEeeCC-ceeEEEEeCCeEEEEE---CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeec
Q 020784 160 IWDDHQSRCIGELSFRS-EVRSVKLRRDRIIVVL---EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPG 235 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~~-~v~~v~~~~~~~~~~~---~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sG 235 (321)
+|++.+...+.++.++. .|..|.|||++-.+++ |.+=|+||+++++.+.-..+|...+..++|.++ |.+++ +|
T Consensus 245 lw~~~~e~~l~~l~gH~~RVs~VafHPsG~~L~TasfD~tWRlWD~~tk~ElL~QEGHs~~v~~iaf~~D--GSL~~-tG 321 (459)
T KOG0272|consen 245 LWKLSQETPLQDLEGHLARVSRVAFHPSGKFLGTASFDSTWRLWDLETKSELLLQEGHSKGVFSIAFQPD--GSLAA-TG 321 (459)
T ss_pred eeccCCCcchhhhhcchhhheeeeecCCCceeeecccccchhhcccccchhhHhhcccccccceeEecCC--Cceee-cc
Confidence 99999988888888765 7999999998655543 579999999999888888999888777777665 47777 69
Q ss_pred CCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcce--eEEEee-c
Q 020784 236 LQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISA--QSGLWL-S 311 (321)
Q Consensus 236 s~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~--~~~~s~-d 311 (321)
+.|..-+|||+.++. ++.|.+|..+|.+|+|+|+|..|||||.|++ +||||++..++++++. +|... .+.|++ .
T Consensus 322 GlD~~~RvWDlRtgr~im~L~gH~k~I~~V~fsPNGy~lATgs~Dnt-~kVWDLR~r~~ly~ip-AH~nlVS~Vk~~p~~ 399 (459)
T KOG0272|consen 322 GLDSLGRVWDLRTGRCIMFLAGHIKEILSVAFSPNGYHLATGSSDNT-CKVWDLRMRSELYTIP-AHSNLVSQVKYSPQE 399 (459)
T ss_pred CccchhheeecccCcEEEEecccccceeeEeECCCceEEeecCCCCc-EEEeeecccccceecc-cccchhhheEecccC
Confidence 999999999999865 8899999999999999999999999999999 9999999999999884 56544 457886 6
Q ss_pred CceEEEee
Q 020784 312 SAWLRVLR 319 (321)
Q Consensus 312 ~~~la~~~ 319 (321)
|+||+.|+
T Consensus 400 g~fL~Tas 407 (459)
T KOG0272|consen 400 GYFLVTAS 407 (459)
T ss_pred CeEEEEcc
Confidence 78898875
No 6
>KOG0273 consensus Beta-transducin family (WD-40 repeat) protein [Chromatin structure and dynamics]
Probab=99.97 E-value=2.9e-28 Score=217.96 Aligned_cols=222 Identities=17% Similarity=0.198 Sum_probs=184.2
Q ss_pred CCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEe
Q 020784 84 PPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWD 162 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD 162 (321)
....|++++|+.+|.+||+|+.+| +|||+..-. ....+.+ |.++|..+.|...+++++.++ .|+++.+||
T Consensus 234 ~nkdVT~L~Wn~~G~~LatG~~~G~~riw~~~G~-l~~tl~~-HkgPI~slKWnk~G~yilS~~-------vD~ttilwd 304 (524)
T KOG0273|consen 234 SNKDVTSLDWNNDGTLLATGSEDGEARIWNKDGN-LISTLGQ-HKGPIFSLKWNKKGTYILSGG-------VDGTTILWD 304 (524)
T ss_pred ccCCcceEEecCCCCeEEEeecCcEEEEEecCch-hhhhhhc-cCCceEEEEEcCCCCEEEecc-------CCccEEEEe
Confidence 335899999999999999999988 679997543 3333444 799999999999999998877 789999999
Q ss_pred CCCCcEEEEEeeCCce-eEEEEeCCe-EEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCC
Q 020784 163 DHQSRCIGELSFRSEV-RSVKLRRDR-IIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKG 239 (321)
Q Consensus 163 ~~~~~~~~~~~~~~~v-~~v~~~~~~-~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg 239 (321)
..++.....+.+++.+ ..|.|-.+. ++.+ +++.|+++.+.....+.++.+|.+++..+.+.+ .+.+|+ +++.|+
T Consensus 305 ~~~g~~~q~f~~~s~~~lDVdW~~~~~F~ts~td~~i~V~kv~~~~P~~t~~GH~g~V~alk~n~--tg~LLa-S~SdD~ 381 (524)
T KOG0273|consen 305 AHTGTVKQQFEFHSAPALDVDWQSNDEFATSSTDGCIHVCKVGEDRPVKTFIGHHGEVNALKWNP--TGSLLA-SCSDDG 381 (524)
T ss_pred ccCceEEEeeeeccCCccceEEecCceEeecCCCceEEEEEecCCCcceeeecccCceEEEEECC--CCceEE-EecCCC
Confidence 9999999999999877 778987654 4444 467999999998899999999888766655544 457777 588888
Q ss_pred cEEEEeeC---------------------------------------------------C-cceEEeeccccceeEEEEC
Q 020784 240 QVRVEHYA---------------------------------------------------S-KRTKFIMAHDSRIACFALT 267 (321)
Q Consensus 240 ~V~i~d~~---------------------------------------------------~-~~~~~l~~H~~~V~~vafs 267 (321)
+++||... . .++.+|..|..+|.+|+||
T Consensus 382 TlkiWs~~~~~~~~~l~~Hskei~t~~wsp~g~v~~n~~~~~~l~sas~dstV~lwdv~~gv~i~~f~kH~~pVysvafS 461 (524)
T KOG0273|consen 382 TLKIWSMGQSNSVHDLQAHSKEIYTIKWSPTGPVTSNPNMNLMLASASFDSTVKLWDVESGVPIHTLMKHQEPVYSVAFS 461 (524)
T ss_pred eeEeeecCCCcchhhhhhhccceeeEeecCCCCccCCCcCCceEEEeecCCeEEEEEccCCceeEeeccCCCceEEEEec
Confidence 88888732 1 1456788999999999999
Q ss_pred CCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEe
Q 020784 268 QDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 268 pdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~ 318 (321)
|+|+|+|+|+.||. |.||++++|++++++........++++.+|.+|+++
T Consensus 462 ~~g~ylAsGs~dg~-V~iws~~~~~l~~s~~~~~~Ifel~Wn~~G~kl~~~ 511 (524)
T KOG0273|consen 462 PNGRYLASGSLDGC-VHIWSTKTGKLVKSYQGTGGIFELCWNAAGDKLGAC 511 (524)
T ss_pred CCCcEEEecCCCCe-eEeccccchheeEeecCCCeEEEEEEcCCCCEEEEE
Confidence 99999999999999 999999999999999655556778999999998875
No 7
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.97 E-value=5.9e-28 Score=226.37 Aligned_cols=225 Identities=16% Similarity=0.236 Sum_probs=190.6
Q ss_pred CCCCeEEEEEcCCCCEEEEEcCC--cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 84 PPPTLLHISFNQDHGCFAAGTDH--GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~~--gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
...+|..++|+..|.+||.|+.+ .+.||++++...++.... |-..+.+++.++++..+++++ .||+||||
T Consensus 306 s~~~I~t~~~N~tGDWiA~g~~klgQLlVweWqsEsYVlKQQg-H~~~i~~l~YSpDgq~iaTG~-------eDgKVKvW 377 (893)
T KOG0291|consen 306 SDQKILTVSFNSTGDWIAFGCSKLGQLLVWEWQSESYVLKQQG-HSDRITSLAYSPDGQLIATGA-------EDGKVKVW 377 (893)
T ss_pred ccceeeEEEecccCCEEEEcCCccceEEEEEeeccceeeeccc-cccceeeEEECCCCcEEEecc-------CCCcEEEE
Confidence 34589999999999999999885 578999998877766664 677899999999999888877 78999999
Q ss_pred eCCCCcEEEEEeeC-CceeEEEEeCCe---EEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCC
Q 020784 162 DDHQSRCIGELSFR-SEVRSVKLRRDR---IIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQ 237 (321)
Q Consensus 162 D~~~~~~~~~~~~~-~~v~~v~~~~~~---~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~ 237 (321)
|...+-|..+|..+ +.|+.++|+... +..+.|++||.||+...+..++|... .++...+++.++.|.++++ |+.
T Consensus 378 n~~SgfC~vTFteHts~Vt~v~f~~~g~~llssSLDGtVRAwDlkRYrNfRTft~P-~p~QfscvavD~sGelV~A-G~~ 455 (893)
T KOG0291|consen 378 NTQSGFCFVTFTEHTSGVTAVQFTARGNVLLSSSLDGTVRAWDLKRYRNFRTFTSP-EPIQFSCVAVDPSGELVCA-GAQ 455 (893)
T ss_pred eccCceEEEEeccCCCceEEEEEEecCCEEEEeecCCeEEeeeecccceeeeecCC-CceeeeEEEEcCCCCEEEe-ecc
Confidence 99999999998765 579999998654 23345899999999999999999875 4556667777877787774 887
Q ss_pred CC-cEEEEeeCCcceE-EeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCC-cEEEEEeCCCcceeEEEeecCce
Q 020784 238 KG-QVRVEHYASKRTK-FIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDG-TLLQEECCPSISAQSGLWLSSAW 314 (321)
Q Consensus 238 dg-~V~i~d~~~~~~~-~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg-~~i~~~~~g~~~~~~~~s~d~~~ 314 (321)
|. .|.+|+++++++. .+.||.++|.+++|+|+|..|||+|+|+| |||||+-.. ..+.++...++...++|.|||+-
T Consensus 456 d~F~IfvWS~qTGqllDiLsGHEgPVs~l~f~~~~~~LaS~SWDkT-VRiW~if~s~~~vEtl~i~sdvl~vsfrPdG~e 534 (893)
T KOG0291|consen 456 DSFEIFVWSVQTGQLLDILSGHEGPVSGLSFSPDGSLLASGSWDKT-VRIWDIFSSSGTVETLEIRSDVLAVSFRPDGKE 534 (893)
T ss_pred ceEEEEEEEeecCeeeehhcCCCCcceeeEEccccCeEEeccccce-EEEEEeeccCceeeeEeeccceeEEEEcCCCCe
Confidence 76 5778999998865 89999999999999999999999999999 999998654 45678888888888899999999
Q ss_pred EEEee
Q 020784 315 LRVLR 319 (321)
Q Consensus 315 la~~~ 319 (321)
||||+
T Consensus 535 laVaT 539 (893)
T KOG0291|consen 535 LAVAT 539 (893)
T ss_pred EEEEE
Confidence 99986
No 8
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=99.96 E-value=5.2e-28 Score=201.13 Aligned_cols=224 Identities=18% Similarity=0.194 Sum_probs=179.8
Q ss_pred CCCCeEEEEEcCCCCEEEEEcCCcEEEEEecCCce--eEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 84 PPPTLLHISFNQDHGCFAAGTDHGFRIYNCDPFRE--IFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~--~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
..+.|+.+.++||++.||+|+...||+||+.+.+. +..++. |.+.|..|.+..+++.+.+.+ .||++|||
T Consensus 39 ~dsqVNrLeiTpdk~~LAaa~~qhvRlyD~~S~np~Pv~t~e~-h~kNVtaVgF~~dgrWMyTgs-------eDgt~kIW 110 (311)
T KOG0315|consen 39 PDSQVNRLEITPDKKDLAAAGNQHVRLYDLNSNNPNPVATFEG-HTKNVTAVGFQCDGRWMYTGS-------EDGTVKIW 110 (311)
T ss_pred CccceeeEEEcCCcchhhhccCCeeEEEEccCCCCCceeEEec-cCCceEEEEEeecCeEEEecC-------CCceEEEE
Confidence 33589999999999999999999999999987764 334443 567888888888898888777 78999999
Q ss_pred eCCCCcEEEEEeeCCceeEEEEeCCe--EEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCC
Q 020784 162 DDHQSRCIGELSFRSEVRSVKLRRDR--IIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQK 238 (321)
Q Consensus 162 D~~~~~~~~~~~~~~~v~~v~~~~~~--~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~d 238 (321)
|++...+.+.+++..+|.++..|++. ++++. ++.|++||+....+.+.+... ....+.++...+|+..++. +...
T Consensus 111 dlR~~~~qR~~~~~spVn~vvlhpnQteLis~dqsg~irvWDl~~~~c~~~liPe-~~~~i~sl~v~~dgsml~a-~nnk 188 (311)
T KOG0315|consen 111 DLRSLSCQRNYQHNSPVNTVVLHPNQTELISGDQSGNIRVWDLGENSCTHELIPE-DDTSIQSLTVMPDGSMLAA-ANNK 188 (311)
T ss_pred eccCcccchhccCCCCcceEEecCCcceEEeecCCCcEEEEEccCCccccccCCC-CCcceeeEEEcCCCcEEEE-ecCC
Confidence 99998888999999999999999864 55554 469999999877665555332 2244556666777788884 8889
Q ss_pred CcEEEEeeCCc-------ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCC-cEEEEEeCCCcc--eeEEE
Q 020784 239 GQVRVEHYASK-------RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDG-TLLQEECCPSIS--AQSGL 308 (321)
Q Consensus 239 g~V~i~d~~~~-------~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg-~~i~~~~~g~~~--~~~~~ 308 (321)
|..++|++... ++..+++|.+.+..+.||||+++|||+|.|.+ ++||++++. ++-..+ .|+.. =.-.|
T Consensus 189 G~cyvW~l~~~~~~s~l~P~~k~~ah~~~il~C~lSPd~k~lat~ssdkt-v~iwn~~~~~kle~~l-~gh~rWvWdc~F 266 (311)
T KOG0315|consen 189 GNCYVWRLLNHQTASELEPVHKFQAHNGHILRCLLSPDVKYLATCSSDKT-VKIWNTDDFFKLELVL-TGHQRWVWDCAF 266 (311)
T ss_pred ccEEEEEccCCCccccceEhhheecccceEEEEEECCCCcEEEeecCCce-EEEEecCCceeeEEEe-ecCCceEEeeee
Confidence 99999997643 34478999999999999999999999999999 999999998 444445 45543 23488
Q ss_pred eecCceEEEee
Q 020784 309 WLSSAWLRVLR 319 (321)
Q Consensus 309 s~d~~~la~~~ 319 (321)
|.||+||..++
T Consensus 267 S~dg~YlvTas 277 (311)
T KOG0315|consen 267 SADGEYLVTAS 277 (311)
T ss_pred ccCccEEEecC
Confidence 99999998764
No 9
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=99.96 E-value=1.6e-27 Score=201.06 Aligned_cols=229 Identities=13% Similarity=0.111 Sum_probs=183.8
Q ss_pred ccCCCCCCeEEEEEcCCC-CEEEEEcCC-cEEEEEecCCc-----eeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCC
Q 020784 80 TSSSPPPTLLHISFNQDH-GCFAAGTDH-GFRIYNCDPFR-----EIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQ 152 (321)
Q Consensus 80 ~~~~~~~~V~~v~fs~dg-~~lasg~~~-gv~vw~~~~~~-----~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~ 152 (321)
....|++.|+.++..+.+ +.|.+++.| .+.+|++.... ....... |.+-|..+.++++++....++
T Consensus 10 tl~gh~d~Vt~la~~~~~~~~l~sasrDk~ii~W~L~~dd~~~G~~~r~~~G-HsH~v~dv~~s~dg~~alS~s------ 82 (315)
T KOG0279|consen 10 TLEGHTDWVTALAIKIKNSDILVSASRDKTIIVWKLTSDDIKYGVPVRRLTG-HSHFVSDVVLSSDGNFALSAS------ 82 (315)
T ss_pred eecCCCceEEEEEeecCCCceEEEcccceEEEEEEeccCccccCceeeeeec-cceEecceEEccCCceEEecc------
Confidence 346788999999999875 567777764 57799885433 2333333 788899999999999887777
Q ss_pred CCCCcEEEEeCCCCcEEEEEeeCC-ceeEEEEeCCeEEEE--E-CCEEEEEEcCCcEEEEEEecc--CCCCceEEEeeCC
Q 020784 153 YPLNKVMIWDDHQSRCIGELSFRS-EVRSVKLRRDRIIVV--L-EQKIFVYNFADLKLLHQIETI--ANPKGLCAVSQGV 226 (321)
Q Consensus 153 ~~d~~v~iWD~~~~~~~~~~~~~~-~v~~v~~~~~~~~~~--~-~~~I~iwd~~~~~~~~~l~~~--~~~~~~~~~s~~~ 226 (321)
.|+++|+||+.+++..+.|..|. .|.+++|+++.--++ + |++|++||+-.. +..++..+ ..++.++.|+|+.
T Consensus 83 -wD~~lrlWDl~~g~~t~~f~GH~~dVlsva~s~dn~qivSGSrDkTiklwnt~g~-ck~t~~~~~~~~WVscvrfsP~~ 160 (315)
T KOG0279|consen 83 -WDGTLRLWDLATGESTRRFVGHTKDVLSVAFSTDNRQIVSGSRDKTIKLWNTLGV-CKYTIHEDSHREWVSCVRFSPNE 160 (315)
T ss_pred -ccceEEEEEecCCcEEEEEEecCCceEEEEecCCCceeecCCCcceeeeeeeccc-EEEEEecCCCcCcEEEEEEcCCC
Confidence 68999999999999888887665 799999998643333 2 579999999754 44455443 6778889999988
Q ss_pred CceEEEeecCCCCcEEEEeeCCcce-EEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCccee
Q 020784 227 GSLVLVCPGLQKGQVRVEHYASKRT-KFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQ 305 (321)
Q Consensus 227 d~~~la~sGs~dg~V~i~d~~~~~~-~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~ 305 (321)
++.+|+ +++.|++|++||+.+-++ .++.+|++.|+.+++||||.++|+|+.||. +.+||++.+++++++........
T Consensus 161 ~~p~Iv-s~s~DktvKvWnl~~~~l~~~~~gh~~~v~t~~vSpDGslcasGgkdg~-~~LwdL~~~k~lysl~a~~~v~s 238 (315)
T KOG0279|consen 161 SNPIIV-SASWDKTVKVWNLRNCQLRTTFIGHSGYVNTVTVSPDGSLCASGGKDGE-AMLWDLNEGKNLYSLEAFDIVNS 238 (315)
T ss_pred CCcEEE-EccCCceEEEEccCCcchhhccccccccEEEEEECCCCCEEecCCCCce-EEEEEccCCceeEeccCCCeEee
Confidence 788888 799999999999988664 589999999999999999999999999999 99999999999998865555555
Q ss_pred EEEeecCceEEEee
Q 020784 306 SGLWLSSAWLRVLR 319 (321)
Q Consensus 306 ~~~s~d~~~la~~~ 319 (321)
++|++.--||+.|.
T Consensus 239 l~fspnrywL~~at 252 (315)
T KOG0279|consen 239 LCFSPNRYWLCAAT 252 (315)
T ss_pred EEecCCceeEeecc
Confidence 57777778887764
No 10
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=99.96 E-value=2.8e-27 Score=200.73 Aligned_cols=228 Identities=14% Similarity=0.119 Sum_probs=186.7
Q ss_pred cccCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCc
Q 020784 79 STSSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNK 157 (321)
Q Consensus 79 ~~~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~ 157 (321)
.+.++|.++|+++.|++|+++|++++.|| +.|||.-+...+....+ ....|..++++|+++.+|..+ -|+.
T Consensus 49 r~LkGH~~Ki~~~~ws~Dsr~ivSaSqDGklIvWDs~TtnK~haipl-~s~WVMtCA~sPSg~~VAcGG-------LdN~ 120 (343)
T KOG0286|consen 49 RTLKGHLNKIYAMDWSTDSRRIVSASQDGKLIVWDSFTTNKVHAIPL-PSSWVMTCAYSPSGNFVACGG-------LDNK 120 (343)
T ss_pred EEecccccceeeeEecCCcCeEEeeccCCeEEEEEcccccceeEEec-CceeEEEEEECCCCCeEEecC-------cCce
Confidence 34578999999999999999999999988 66999988777766666 356788889999999888776 6799
Q ss_pred EEEEeCCCC------cEEEEEeeCC-ceeEEEEeCCeEEEE--ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCc
Q 020784 158 VMIWDDHQS------RCIGELSFRS-EVRSVKLRRDRIIVV--LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGS 228 (321)
Q Consensus 158 v~iWD~~~~------~~~~~~~~~~-~v~~v~~~~~~~~~~--~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~ 228 (321)
..||++.+. ...+++..+. .+.++.|-.+..++. +|.+..+||+++++.++.|.+|...+..+++++. ++
T Consensus 121 Csiy~ls~~d~~g~~~v~r~l~gHtgylScC~f~dD~~ilT~SGD~TCalWDie~g~~~~~f~GH~gDV~slsl~p~-~~ 199 (343)
T KOG0286|consen 121 CSIYPLSTRDAEGNVRVSRELAGHTGYLSCCRFLDDNHILTGSGDMTCALWDIETGQQTQVFHGHTGDVMSLSLSPS-DG 199 (343)
T ss_pred eEEEecccccccccceeeeeecCccceeEEEEEcCCCceEecCCCceEEEEEcccceEEEEecCCcccEEEEecCCC-CC
Confidence 999998755 2334455444 566777876654444 3459999999999999999999888777777774 55
Q ss_pred eEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcce---
Q 020784 229 LVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISA--- 304 (321)
Q Consensus 229 ~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~--- 304 (321)
+.++ +|+.|+..++||++.+. ..+|.+|.+.|++|+|.|+|.-|||||+|++ .|+||++..+.+..|......+
T Consensus 200 ntFv-Sg~cD~~aklWD~R~~~c~qtF~ghesDINsv~ffP~G~afatGSDD~t-cRlyDlRaD~~~a~ys~~~~~~git 277 (343)
T KOG0286|consen 200 NTFV-SGGCDKSAKLWDVRSGQCVQTFEGHESDINSVRFFPSGDAFATGSDDAT-CRLYDLRADQELAVYSHDSIICGIT 277 (343)
T ss_pred CeEE-ecccccceeeeeccCcceeEeecccccccceEEEccCCCeeeecCCCce-eEEEeecCCcEEeeeccCcccCCce
Confidence 7777 69999999999998765 6699999999999999999999999999999 9999999999999886444333
Q ss_pred eEEEeecCceEEE
Q 020784 305 QSGLWLSSAWLRV 317 (321)
Q Consensus 305 ~~~~s~d~~~la~ 317 (321)
.+.||-+|++|-.
T Consensus 278 Sv~FS~SGRlLfa 290 (343)
T KOG0286|consen 278 SVAFSKSGRLLFA 290 (343)
T ss_pred eEEEcccccEEEe
Confidence 3488899998754
No 11
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=99.96 E-value=1.3e-28 Score=232.03 Aligned_cols=198 Identities=15% Similarity=0.225 Sum_probs=175.3
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCC-cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDH-GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~-gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
..+|.++|+.++|+||.++|+++++| +||+|.+++......... |..+|..|.++|.+=++|+++ .|++.+
T Consensus 447 L~GH~GPVyg~sFsPd~rfLlScSED~svRLWsl~t~s~~V~y~G-H~~PVwdV~F~P~GyYFatas-------~D~tAr 518 (707)
T KOG0263|consen 447 LYGHSGPVYGCSFSPDRRFLLSCSEDSSVRLWSLDTWSCLVIYKG-HLAPVWDVQFAPRGYYFATAS-------HDQTAR 518 (707)
T ss_pred eecCCCceeeeeecccccceeeccCCcceeeeecccceeEEEecC-CCcceeeEEecCCceEEEecC-------CCceee
Confidence 36899999999999999999999985 599999999988777765 788999999988887777776 679999
Q ss_pred EEeCCCCcEEEEEeeC-CceeEEEEeCCeEEEEE---CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeec
Q 020784 160 IWDDHQSRCIGELSFR-SEVRSVKLRRDRIIVVL---EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPG 235 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~-~~v~~v~~~~~~~~~~~---~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sG 235 (321)
+|.....+..+.+..+ ..|.++.|||+.-++++ |.+||+||+.+|..++.|.+|..++.++++++ +|.+|| +|
T Consensus 519 LWs~d~~~PlRifaghlsDV~cv~FHPNs~Y~aTGSsD~tVRlWDv~~G~~VRiF~GH~~~V~al~~Sp--~Gr~La-Sg 595 (707)
T KOG0263|consen 519 LWSTDHNKPLRIFAGHLSDVDCVSFHPNSNYVATGSSDRTVRLWDVSTGNSVRIFTGHKGPVTALAFSP--CGRYLA-SG 595 (707)
T ss_pred eeecccCCchhhhcccccccceEEECCcccccccCCCCceEEEEEcCCCcEEEEecCCCCceEEEEEcC--CCceEe-ec
Confidence 9999888877777655 58999999999877764 46999999999999999999999988888888 459999 69
Q ss_pred CCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 236 LQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 236 s~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
+.||.|.|||+.++. ++.+++|++.|.+|.||.||..||+||.|.+ |++||+..
T Consensus 596 ~ed~~I~iWDl~~~~~v~~l~~Ht~ti~SlsFS~dg~vLasgg~Dns-V~lWD~~~ 650 (707)
T KOG0263|consen 596 DEDGLIKIWDLANGSLVKQLKGHTGTIYSLSFSRDGNVLASGGADNS-VRLWDLTK 650 (707)
T ss_pred ccCCcEEEEEcCCCcchhhhhcccCceeEEEEecCCCEEEecCCCCe-EEEEEchh
Confidence 999999999999865 6799999999999999999999999999999 99999875
No 12
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=99.96 E-value=3.6e-28 Score=229.13 Aligned_cols=231 Identities=13% Similarity=0.150 Sum_probs=190.8
Q ss_pred CCCcccCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCc-----------e------------------eEEe-ee
Q 020784 76 PAESTSSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFR-----------E------------------IFRR-DF 124 (321)
Q Consensus 76 ~~~~~~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~-----------~------------------~~~~-~~ 124 (321)
..|++... ...|+|+.|++|+++||+|-.+. |++|.+.+.+ . ...+ -.
T Consensus 370 c~YT~~nt-~~~v~ca~fSddssmlA~Gf~dS~i~~~Sl~p~kl~~lk~~~~l~~~d~~sad~~~~~~D~~~~~~~~~L~ 448 (707)
T KOG0263|consen 370 CMYTFHNT-YQGVTCAEFSDDSSMLACGFVDSSVRVWSLTPKKLKKLKDASDLSNIDTESADVDVDMLDDDSSGTSRTLY 448 (707)
T ss_pred EEEEEEEc-CCcceeEeecCCcchhhccccccEEEEEecchhhhccccchhhhccccccccchhhhhccccCCceeEEee
Confidence 33444333 35799999999999999998755 8899876321 0 0011 12
Q ss_pred ecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCC-ceeEEEEeCCeEEEEE---CCEEEEEE
Q 020784 125 ERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRS-EVRSVKLRRDRIIVVL---EQKIFVYN 200 (321)
Q Consensus 125 ~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~-~v~~v~~~~~~~~~~~---~~~I~iwd 200 (321)
.|.++|..+.++++.+.++.++ .|.+||+|.+.+..++...+.+. +|..+.|.|.+...++ |++-++|.
T Consensus 449 GH~GPVyg~sFsPd~rfLlScS-------ED~svRLWsl~t~s~~V~y~GH~~PVwdV~F~P~GyYFatas~D~tArLWs 521 (707)
T KOG0263|consen 449 GHSGPVYGCSFSPDRRFLLSCS-------EDSSVRLWSLDTWSCLVIYKGHLAPVWDVQFAPRGYYFATASHDQTARLWS 521 (707)
T ss_pred cCCCceeeeeecccccceeecc-------CCcceeeeecccceeEEEecCCCcceeeEEecCCceEEEecCCCceeeeee
Confidence 2889999999999999998888 78999999999999888887664 8999999987654443 46999999
Q ss_pred cCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCC
Q 020784 201 FADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTK 279 (321)
Q Consensus 201 ~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~D 279 (321)
....+.++.|.+|...+.++.|+|+. .++| +|+.|.+|++||..++. +..|.||+++|.+|+|||+|++||||++|
T Consensus 522 ~d~~~PlRifaghlsDV~cv~FHPNs--~Y~a-TGSsD~tVRlWDv~~G~~VRiF~GH~~~V~al~~Sp~Gr~LaSg~ed 598 (707)
T KOG0263|consen 522 TDHNKPLRIFAGHLSDVDCVSFHPNS--NYVA-TGSSDRTVRLWDVSTGNSVRIFTGHKGPVTALAFSPCGRYLASGDED 598 (707)
T ss_pred cccCCchhhhcccccccceEEECCcc--cccc-cCCCCceEEEEEcCCCcEEEEecCCCCceEEEEEcCCCceEeecccC
Confidence 99999999999999999888887754 8998 59999999999998876 66899999999999999999999999999
Q ss_pred CcEEEEEEcCCCcEEEEEeCCCccee--EEEeecCceEEEee
Q 020784 280 GTLVRIFNTLDGTLLQEECCPSISAQ--SGLWLSSAWLRVLR 319 (321)
Q Consensus 280 gt~IrIWd~~tg~~i~~~~~g~~~~~--~~~s~d~~~la~~~ 319 (321)
|. |+|||+.+|+++.++. +|...+ +.|+.||..||++.
T Consensus 599 ~~-I~iWDl~~~~~v~~l~-~Ht~ti~SlsFS~dg~vLasgg 638 (707)
T KOG0263|consen 599 GL-IKIWDLANGSLVKQLK-GHTGTIYSLSFSRDGNVLASGG 638 (707)
T ss_pred Cc-EEEEEcCCCcchhhhh-cccCceeEEEEecCCCEEEecC
Confidence 99 9999999999999984 565433 48899999999864
No 13
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=99.96 E-value=6.8e-27 Score=194.46 Aligned_cols=214 Identities=15% Similarity=0.243 Sum_probs=173.9
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
.+|...|+.|.|..||+++++|++|| ++|||+...... +.++|..+|..+..+++...++++. .+|.|+|
T Consensus 80 e~h~kNVtaVgF~~dgrWMyTgseDgt~kIWdlR~~~~q--R~~~~~spVn~vvlhpnQteLis~d-------qsg~irv 150 (311)
T KOG0315|consen 80 EGHTKNVTAVGFQCDGRWMYTGSEDGTVKIWDLRSLSCQ--RNYQHNSPVNTVVLHPNQTELISGD-------QSGNIRV 150 (311)
T ss_pred eccCCceEEEEEeecCeEEEecCCCceEEEEeccCcccc--hhccCCCCcceEEecCCcceEEeec-------CCCcEEE
Confidence 46777999999999999999999977 779999886553 4444578999999988888787766 6799999
Q ss_pred EeCCCCcEEEEEee--CCceeEEEEeCCe--EEEEEC-CEEEEEEcCC------cEEEEEEeccCCCCceEEEeeCCCce
Q 020784 161 WDDHQSRCIGELSF--RSEVRSVKLRRDR--IIVVLE-QKIFVYNFAD------LKLLHQIETIANPKGLCAVSQGVGSL 229 (321)
Q Consensus 161 WD~~~~~~~~~~~~--~~~v~~v~~~~~~--~~~~~~-~~I~iwd~~~------~~~~~~l~~~~~~~~~~~~s~~~d~~ 229 (321)
||+.+..+..++.- ...|.++.++++. ++.+.. +...+|++.+ .+.+.+|+.|...+..|.++++ +.
T Consensus 151 WDl~~~~c~~~liPe~~~~i~sl~v~~dgsml~a~nnkG~cyvW~l~~~~~~s~l~P~~k~~ah~~~il~C~lSPd--~k 228 (311)
T KOG0315|consen 151 WDLGENSCTHELIPEDDTSIQSLTVMPDGSMLAAANNKGNCYVWRLLNHQTASELEPVHKFQAHNGHILRCLLSPD--VK 228 (311)
T ss_pred EEccCCccccccCCCCCcceeeEEEcCCCcEEEEecCCccEEEEEccCCCccccceEhhheecccceEEEEEECCC--Cc
Confidence 99998877666533 2468888887764 444443 6999999853 4566778888777777888775 58
Q ss_pred EEEeecCCCCcEEEEeeCCc--ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEE
Q 020784 230 VLVCPGLQKGQVRVEHYASK--RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSG 307 (321)
Q Consensus 230 ~la~sGs~dg~V~i~d~~~~--~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~ 307 (321)
+||. ++.|.+|+||+..+. ...++.+|.+.|..++||.||+||+|||.|++ +|+|+++.|+.++.+ .||.+..++
T Consensus 229 ~lat-~ssdktv~iwn~~~~~kle~~l~gh~rWvWdc~FS~dg~YlvTassd~~-~rlW~~~~~k~v~qy-~gh~K~~vc 305 (311)
T KOG0315|consen 229 YLAT-CSSDKTVKIWNTDDFFKLELVLTGHQRWVWDCAFSADGEYLVTASSDHT-ARLWDLSAGKEVRQY-QGHHKAAVC 305 (311)
T ss_pred EEEe-ecCCceEEEEecCCceeeEEEeecCCceEEeeeeccCccEEEecCCCCc-eeecccccCceeeec-CCcccccEE
Confidence 9995 899999999998765 34589999999999999999999999999999 999999999999988 577777665
Q ss_pred Ee
Q 020784 308 LW 309 (321)
Q Consensus 308 ~s 309 (321)
..
T Consensus 306 ~~ 307 (311)
T KOG0315|consen 306 VA 307 (311)
T ss_pred EE
Confidence 54
No 14
>KOG0295 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.96 E-value=2.8e-27 Score=205.83 Aligned_cols=221 Identities=15% Similarity=0.226 Sum_probs=185.4
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
++|.+.|..|+|+..|++||+++.|. +.+||.++.-.......+|++.|..+.+.+-++.++.++ .|++|+.
T Consensus 147 rGHt~sv~di~~~a~Gk~l~tcSsDl~~~LWd~~~~~~c~ks~~gh~h~vS~V~f~P~gd~ilS~s-------rD~tik~ 219 (406)
T KOG0295|consen 147 RGHTDSVFDISFDASGKYLATCSSDLSAKLWDFDTFFRCIKSLIGHEHGVSSVFFLPLGDHILSCS-------RDNTIKA 219 (406)
T ss_pred hccccceeEEEEecCccEEEecCCccchhheeHHHHHHHHHHhcCcccceeeEEEEecCCeeeecc-------cccceeE
Confidence 67888999999999999999999877 889999874222222223788999999999999998888 7899999
Q ss_pred EeCCCCcEEEEEeeCC-ceeEEEEeCCeEEEEE---CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCC----------
Q 020784 161 WDDHQSRCIGELSFRS-EVRSVKLRRDRIIVVL---EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGV---------- 226 (321)
Q Consensus 161 WD~~~~~~~~~~~~~~-~v~~v~~~~~~~~~~~---~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~---------- 226 (321)
||+.++-++.++..+. -|..+..+.++.++++ +.++++|-+.++++...+..|..++.++++.+..
T Consensus 220 We~~tg~cv~t~~~h~ewvr~v~v~~DGti~As~s~dqtl~vW~~~t~~~k~~lR~hEh~vEci~wap~~~~~~i~~at~ 299 (406)
T KOG0295|consen 220 WECDTGYCVKTFPGHSEWVRMVRVNQDGTIIASCSNDQTLRVWVVATKQCKAELREHEHPVECIAWAPESSYPSISEATG 299 (406)
T ss_pred EecccceeEEeccCchHhEEEEEecCCeeEEEecCCCceEEEEEeccchhhhhhhccccceEEEEecccccCcchhhccC
Confidence 9999999999998776 4888899998876664 3599999999998888888888888777765531
Q ss_pred ---CceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCc
Q 020784 227 ---GSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSI 302 (321)
Q Consensus 227 ---d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~ 302 (321)
.+.+++ +|+-|++|++||+.++. +.+|.+|.+.|+.++|+|.|+||+|+.+|++ +||||+++++|.+++. .+.
T Consensus 300 ~~~~~~~l~-s~SrDktIk~wdv~tg~cL~tL~ghdnwVr~~af~p~Gkyi~ScaDDkt-lrvwdl~~~~cmk~~~-ah~ 376 (406)
T KOG0295|consen 300 STNGGQVLG-SGSRDKTIKIWDVSTGMCLFTLVGHDNWVRGVAFSPGGKYILSCADDKT-LRVWDLKNLQCMKTLE-AHE 376 (406)
T ss_pred CCCCccEEE-eecccceEEEEeccCCeEEEEEecccceeeeeEEcCCCeEEEEEecCCc-EEEEEeccceeeeccC-CCc
Confidence 124666 69999999999999865 7899999999999999999999999999999 9999999999999986 666
Q ss_pred ceeEEEeecC
Q 020784 303 SAQSGLWLSS 312 (321)
Q Consensus 303 ~~~~~~s~d~ 312 (321)
-...++.+.-
T Consensus 377 hfvt~lDfh~ 386 (406)
T KOG0295|consen 377 HFVTSLDFHK 386 (406)
T ss_pred ceeEEEecCC
Confidence 6666655544
No 15
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=99.95 E-value=4.9e-26 Score=192.07 Aligned_cols=205 Identities=10% Similarity=0.102 Sum_probs=165.9
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
..+|...|..+..++||++..+|+-|+ +|+||+.+++....... |...|..++++.+...+++.+ .|++|+
T Consensus 59 ~~GHsH~v~dv~~s~dg~~alS~swD~~lrlWDl~~g~~t~~f~G-H~~dVlsva~s~dn~qivSGS-------rDkTik 130 (315)
T KOG0279|consen 59 LTGHSHFVSDVVLSSDGNFALSASWDGTLRLWDLATGESTRRFVG-HTKDVLSVAFSTDNRQIVSGS-------RDKTIK 130 (315)
T ss_pred eeccceEecceEEccCCceEEeccccceEEEEEecCCcEEEEEEe-cCCceEEEEecCCCceeecCC-------Ccceee
Confidence 456777999999999999999998755 88999999866555544 778888888888777665544 789999
Q ss_pred EEeCCCCcEEEEEee--CCceeEEEEeCC--eEEE--E-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEE
Q 020784 160 IWDDHQSRCIGELSF--RSEVRSVKLRRD--RIIV--V-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLV 232 (321)
Q Consensus 160 iWD~~~~~~~~~~~~--~~~v~~v~~~~~--~~~~--~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la 232 (321)
+||....+....... ..-|.+++|+|+ ..++ + .|++||+||+++.++.+.+.+|...+..+.+++++ .+.+
T Consensus 131 lwnt~g~ck~t~~~~~~~~WVscvrfsP~~~~p~Ivs~s~DktvKvWnl~~~~l~~~~~gh~~~v~t~~vSpDG--slca 208 (315)
T KOG0279|consen 131 LWNTLGVCKYTIHEDSHREWVSCVRFSPNESNPIIVSASWDKTVKVWNLRNCQLRTTFIGHSGYVNTVTVSPDG--SLCA 208 (315)
T ss_pred eeeecccEEEEEecCCCcCcEEEEEEcCCCCCcEEEEccCCceEEEEccCCcchhhccccccccEEEEEECCCC--CEEe
Confidence 999876655443333 345999999987 2333 3 35799999999999999999998888888888865 7777
Q ss_pred eecCCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEe
Q 020784 233 CPGLQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEEC 298 (321)
Q Consensus 233 ~sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~ 298 (321)
+|+.||.+.+||++.+.-.....|...|++++|+|+...|+.+ .+-. |||||+.++.++.+++
T Consensus 209 -sGgkdg~~~LwdL~~~k~lysl~a~~~v~sl~fspnrywL~~a-t~~s-IkIwdl~~~~~v~~l~ 271 (315)
T KOG0279|consen 209 -SGGKDGEAMLWDLNEGKNLYSLEAFDIVNSLCFSPNRYWLCAA-TATS-IKIWDLESKAVVEELK 271 (315)
T ss_pred -cCCCCceEEEEEccCCceeEeccCCCeEeeEEecCCceeEeec-cCCc-eEEEeccchhhhhhcc
Confidence 6999999999999987766666899999999999998777655 4666 9999999999988775
No 16
>KOG0276 consensus Vesicle coat complex COPI, beta' subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.95 E-value=2.3e-26 Score=211.95 Aligned_cols=210 Identities=14% Similarity=0.171 Sum_probs=184.9
Q ss_pred CCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 83 SPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
-..-+|+++.|-.--+++++|+||. ||||+..+++.+...+. |..-|++++.+|...++.+++ +|-+||+|
T Consensus 53 V~~~PvRa~kfiaRknWiv~GsDD~~IrVfnynt~ekV~~FeA-H~DyIR~iavHPt~P~vLtsS-------DDm~iKlW 124 (794)
T KOG0276|consen 53 VSEVPVRAAKFIARKNWIVTGSDDMQIRVFNYNTGEKVKTFEA-HSDYIRSIAVHPTLPYVLTSS-------DDMTIKLW 124 (794)
T ss_pred ecccchhhheeeeccceEEEecCCceEEEEecccceeeEEeec-cccceeeeeecCCCCeEEecC-------CccEEEEe
Confidence 3445899999999999999999976 89999999999888776 788899999999988888877 78999999
Q ss_pred eCCCC-cEEEEEeeCC-ceeEEEEeCC---eEEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeec
Q 020784 162 DDHQS-RCIGELSFRS-EVRSVKLRRD---RIIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPG 235 (321)
Q Consensus 162 D~~~~-~~~~~~~~~~-~v~~v~~~~~---~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sG 235 (321)
|.+++ .+.++++.|. .|++++|+|+ .++.+ .|++|++|.+.......++++|...+.++++-+.+|..+|+ +|
T Consensus 125 ~we~~wa~~qtfeGH~HyVMqv~fnPkD~ntFaS~sLDrTVKVWslgs~~~nfTl~gHekGVN~Vdyy~~gdkpylI-sg 203 (794)
T KOG0276|consen 125 DWENEWACEQTFEGHEHYVMQVAFNPKDPNTFASASLDRTVKVWSLGSPHPNFTLEGHEKGVNCVDYYTGGDKPYLI-SG 203 (794)
T ss_pred eccCceeeeeEEcCcceEEEEEEecCCCccceeeeeccccEEEEEcCCCCCceeeeccccCcceEEeccCCCcceEE-ec
Confidence 99865 4677787776 6999999985 45554 58899999999999999999999999999999999999998 69
Q ss_pred CCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCc
Q 020784 236 LQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSI 302 (321)
Q Consensus 236 s~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~ 302 (321)
+.|.+|+|||++++. +.+|.||...|..++|+|.-.+++|||+||| ||||+..|.++..++..|..
T Consensus 204 aDD~tiKvWDyQtk~CV~TLeGHt~Nvs~v~fhp~lpiiisgsEDGT-vriWhs~Ty~lE~tLn~gle 270 (794)
T KOG0276|consen 204 ADDLTIKVWDYQTKSCVQTLEGHTNNVSFVFFHPELPIIISGSEDGT-VRIWNSKTYKLEKTLNYGLE 270 (794)
T ss_pred CCCceEEEeecchHHHHHHhhcccccceEEEecCCCcEEEEecCCcc-EEEecCcceehhhhhhcCCc
Confidence 999999999999976 7799999999999999999999999999999 99999999887776655443
No 17
>KOG0292 consensus Vesicle coat complex COPI, alpha subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.95 E-value=6e-26 Score=215.98 Aligned_cols=225 Identities=14% Similarity=0.182 Sum_probs=182.9
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
...|.++|+.|+|+|++.+|++|+||- |+||+.++.+++++... |-.-|+.+.+++.-..++.++ +|.|||
T Consensus 47 FdeHdGpVRgv~FH~~qplFVSGGDDykIkVWnYk~rrclftL~G-HlDYVRt~~FHheyPWIlSAS-------DDQTIr 118 (1202)
T KOG0292|consen 47 FDEHDGPVRGVDFHPTQPLFVSGGDDYKIKVWNYKTRRCLFTLLG-HLDYVRTVFFHHEYPWILSAS-------DDQTIR 118 (1202)
T ss_pred hhccCCccceeeecCCCCeEEecCCccEEEEEecccceehhhhcc-ccceeEEeeccCCCceEEEcc-------CCCeEE
Confidence 457889999999999999999999965 88999999999888775 677788888888888888777 789999
Q ss_pred EEeCCCCcEEEEEeeCC-ceeEEEEeCC-eE-EEE-ECCEEEEEEcCCc---------------------------E--E
Q 020784 160 IWDDHQSRCIGELSFRS-EVRSVKLRRD-RI-IVV-LEQKIFVYNFADL---------------------------K--L 206 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~~-~v~~v~~~~~-~~-~~~-~~~~I~iwd~~~~---------------------------~--~ 206 (321)
||+.++++++..+..|. .|+|..||+. .+ +.+ .|.+||+||+... . .
T Consensus 119 IWNwqsr~~iavltGHnHYVMcAqFhptEDlIVSaSLDQTVRVWDisGLRkk~~~pg~~e~~~~~~~~~~dLfg~~DaVV 198 (1202)
T KOG0292|consen 119 IWNWQSRKCIAVLTGHNHYVMCAQFHPTEDLIVSASLDQTVRVWDISGLRKKNKAPGSLEDQMRGQQGNSDLFGQTDAVV 198 (1202)
T ss_pred EEeccCCceEEEEecCceEEEeeccCCccceEEEecccceEEEEeecchhccCCCCCCchhhhhccccchhhcCCcCeee
Confidence 99999999999998776 6999999983 33 333 4689999998521 1 1
Q ss_pred EEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc---eEEeeccccceeEEEECCCCCEEEEEeCCCcEE
Q 020784 207 LHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR---TKFIMAHDSRIACFALTQDGQLLATSSTKGTLV 283 (321)
Q Consensus 207 ~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~---~~~l~~H~~~V~~vafspdg~~las~S~Dgt~I 283 (321)
.+.+++|...+.-++|++. -.+++ ||+.|..|++|.++... +-+.++|.+.|.|+-|+|...++.|.|+|++ |
T Consensus 199 K~VLEGHDRGVNwaAfhpT--lpliV-SG~DDRqVKlWrmnetKaWEvDtcrgH~nnVssvlfhp~q~lIlSnsEDks-i 274 (1202)
T KOG0292|consen 199 KHVLEGHDRGVNWAAFHPT--LPLIV-SGADDRQVKLWRMNETKAWEVDTCRGHYNNVSSVLFHPHQDLILSNSEDKS-I 274 (1202)
T ss_pred eeeecccccccceEEecCC--cceEE-ecCCcceeeEEEeccccceeehhhhcccCCcceEEecCccceeEecCCCcc-E
Confidence 2344666666666666654 36776 79999999999987654 3378999999999999999999999999999 9
Q ss_pred EEEEcCCCcEEEEEeCCCcce-eEEEeecCceEEE
Q 020784 284 RIFNTLDGTLLQEECCPSISA-QSGLWLSSAWLRV 317 (321)
Q Consensus 284 rIWd~~tg~~i~~~~~g~~~~-~~~~s~d~~~la~ 317 (321)
||||+...+.+++|++.++.. .++.-+....+|+
T Consensus 275 rVwDm~kRt~v~tfrrendRFW~laahP~lNLfAA 309 (1202)
T KOG0292|consen 275 RVWDMTKRTSVQTFRRENDRFWILAAHPELNLFAA 309 (1202)
T ss_pred EEEecccccceeeeeccCCeEEEEEecCCcceeee
Confidence 999999999999999888765 3355566666655
No 18
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=99.95 E-value=1.5e-26 Score=192.58 Aligned_cols=200 Identities=19% Similarity=0.278 Sum_probs=161.6
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEE-eeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFR-RDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~-~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
..|..-|..|+|++|..+|++|+. +-+||||++..+-.-. ... |.+.|..+.|+...+.+...+ .|++||
T Consensus 97 f~hkhivk~~af~~ds~~lltgg~ekllrvfdln~p~App~E~~g-htg~Ir~v~wc~eD~~iLSSa-------dd~tVR 168 (334)
T KOG0278|consen 97 FEHKHIVKAVAFSQDSNYLLTGGQEKLLRVFDLNRPKAPPKEISG-HTGGIRTVLWCHEDKCILSSA-------DDKTVR 168 (334)
T ss_pred hhhhheeeeEEecccchhhhccchHHHhhhhhccCCCCCchhhcC-CCCcceeEEEeccCceEEeec-------cCCceE
Confidence 446669999999999999999998 5578999976542211 111 678899999988777666654 689999
Q ss_pred EEeCCCCcEEEEEeeCCceeEEEEeCCe--EEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCC
Q 020784 160 IWDDHQSRCIGELSFRSEVRSVKLRRDR--IIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQ 237 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~~~v~~v~~~~~~--~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~ 237 (321)
+||.+++..++.+.+..+|.++.++++. +.++-.+.|++||..+..+++.++... .+.+.+..|+..++++ |+.
T Consensus 169 LWD~rTgt~v~sL~~~s~VtSlEvs~dG~ilTia~gssV~Fwdaksf~~lKs~k~P~---nV~SASL~P~k~~fVa-Gge 244 (334)
T KOG0278|consen 169 LWDHRTGTEVQSLEFNSPVTSLEVSQDGRILTIAYGSSVKFWDAKSFGLLKSYKMPC---NVESASLHPKKEFFVA-GGE 244 (334)
T ss_pred EEEeccCcEEEEEecCCCCcceeeccCCCEEEEecCceeEEeccccccceeeccCcc---ccccccccCCCceEEe-cCc
Confidence 9999999999999999999999998765 444456799999999999888877643 3444455555567764 999
Q ss_pred CCcEEEEeeCCcceE-Ee-eccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEE
Q 020784 238 KGQVRVEHYASKRTK-FI-MAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLL 294 (321)
Q Consensus 238 dg~V~i~d~~~~~~~-~l-~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i 294 (321)
|+.++.+|+.++... .+ ++|-++|.||.|+|+|..-|+||+||+ ||||.+..++..
T Consensus 245 d~~~~kfDy~TgeEi~~~nkgh~gpVhcVrFSPdGE~yAsGSEDGT-irlWQt~~~~~~ 302 (334)
T KOG0278|consen 245 DFKVYKFDYNTGEEIGSYNKGHFGPVHCVRFSPDGELYASGSEDGT-IRLWQTTPGKTY 302 (334)
T ss_pred ceEEEEEeccCCceeeecccCCCCceEEEEECCCCceeeccCCCce-EEEEEecCCCch
Confidence 999999999887644 44 899999999999999999999999999 999999877643
No 19
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.94 E-value=5e-25 Score=206.82 Aligned_cols=224 Identities=16% Similarity=0.201 Sum_probs=180.4
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
.+|-..|+|++++|||+++|+|++|+ |+|||...+-+..+..- |...+..+.+...++.+.+++ -||+||.
T Consensus 347 QgH~~~i~~l~YSpDgq~iaTG~eDgKVKvWn~~SgfC~vTFte-Hts~Vt~v~f~~~g~~llssS-------LDGtVRA 418 (893)
T KOG0291|consen 347 QGHSDRITSLAYSPDGQLIATGAEDGKVKVWNTQSGFCFVTFTE-HTSGVTAVQFTARGNVLLSSS-------LDGTVRA 418 (893)
T ss_pred cccccceeeEEECCCCcEEEeccCCCcEEEEeccCceEEEEecc-CCCceEEEEEEecCCEEEEee-------cCCeEEe
Confidence 56778999999999999999999976 99999999877766654 788999999999999888887 7899999
Q ss_pred EeCCCCcEEEEEeeCCce--eEEEEeCCeEEEE--ECC--EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEee
Q 020784 161 WDDHQSRCIGELSFRSEV--RSVKLRRDRIIVV--LEQ--KIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCP 234 (321)
Q Consensus 161 WD~~~~~~~~~~~~~~~v--~~v~~~~~~~~~~--~~~--~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~s 234 (321)
||+...++.++++.+.++ .+++..+...+++ ..+ .|++|++++|+++-.+.+|..|+..++|++.+ ..|| |
T Consensus 419 wDlkRYrNfRTft~P~p~QfscvavD~sGelV~AG~~d~F~IfvWS~qTGqllDiLsGHEgPVs~l~f~~~~--~~La-S 495 (893)
T KOG0291|consen 419 WDLKRYRNFRTFTSPEPIQFSCVAVDPSGELVCAGAQDSFEIFVWSVQTGQLLDILSGHEGPVSGLSFSPDG--SLLA-S 495 (893)
T ss_pred eeecccceeeeecCCCceeeeEEEEcCCCCEEEeeccceEEEEEEEeecCeeeehhcCCCCcceeeEEcccc--CeEE-e
Confidence 999999999999887754 4555665443333 223 89999999999999999999998887887765 6787 7
Q ss_pred cCCCCcEEEEeeCCc-ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEe---------------
Q 020784 235 GLQKGQVRVEHYASK-RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEEC--------------- 298 (321)
Q Consensus 235 Gs~dg~V~i~d~~~~-~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~--------------- 298 (321)
|+-|++|++|+.-.. ....--.+...|..++|+|||+-||.+.-||. |.+||...+....+.+
T Consensus 496 ~SWDkTVRiW~if~s~~~vEtl~i~sdvl~vsfrPdG~elaVaTldgq-Itf~d~~~~~q~~~IdgrkD~~~gR~~~D~~ 574 (893)
T KOG0291|consen 496 GSWDKTVRIWDIFSSSGTVETLEIRSDVLAVSFRPDGKELAVATLDGQ-ITFFDIKEAVQVGSIDGRKDLSGGRKETDRI 574 (893)
T ss_pred ccccceEEEEEeeccCceeeeEeeccceeEEEEcCCCCeEEEEEecce-EEEEEhhhceeeccccchhhcccccccccee
Confidence 999999999997543 23333457788999999999999999999999 9999998776553221
Q ss_pred -CC-----CcceeEEEeecCceEEE
Q 020784 299 -CP-----SISAQSGLWLSSAWLRV 317 (321)
Q Consensus 299 -~g-----~~~~~~~~s~d~~~la~ 317 (321)
.. ..-..+++|+||.+|..
T Consensus 575 ta~~sa~~K~Ftti~ySaDG~~IlA 599 (893)
T KOG0291|consen 575 TAENSAKGKTFTTICYSADGKCILA 599 (893)
T ss_pred ehhhcccCCceEEEEEcCCCCEEEe
Confidence 11 11134588999988754
No 20
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=99.94 E-value=5.7e-25 Score=209.09 Aligned_cols=223 Identities=15% Similarity=0.201 Sum_probs=178.4
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCc--eeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFR--EIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~--~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
..+...|.|+.|++||++|++++. +.+++|+....+ ...... .|...|..++|++++..++.++ .|++|
T Consensus 156 ~~~~~sv~~~~fs~~g~~l~~~~~~~~i~~~~~~~~~~~~~~~l~-~h~~~v~~~~fs~d~~~l~s~s-------~D~ti 227 (456)
T KOG0266|consen 156 GHECPSVTCVDFSPDGRALAAASSDGLIRIWKLEGIKSNLLRELS-GHTRGVSDVAFSPDGSYLLSGS-------DDKTL 227 (456)
T ss_pred ccccCceEEEEEcCCCCeEEEccCCCcEEEeecccccchhhcccc-ccccceeeeEECCCCcEEEEec-------CCceE
Confidence 334678999999999999998876 558899996666 333332 2677899999999999777776 78999
Q ss_pred EEEeC-CCCcEEEEEeeCC-ceeEEEEeCCe--EEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEe
Q 020784 159 MIWDD-HQSRCIGELSFRS-EVRSVKLRRDR--IIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVC 233 (321)
Q Consensus 159 ~iWD~-~~~~~~~~~~~~~-~v~~v~~~~~~--~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~ 233 (321)
||||+ ..+.++..+..+. .|++++|+++. ++.+. |++|||||+++++++.++.+|...+..++|+. ++.+++
T Consensus 228 riwd~~~~~~~~~~l~gH~~~v~~~~f~p~g~~i~Sgs~D~tvriWd~~~~~~~~~l~~hs~~is~~~f~~--d~~~l~- 304 (456)
T KOG0266|consen 228 RIWDLKDDGRNLKTLKGHSTYVTSVAFSPDGNLLVSGSDDGTVRIWDVRTGECVRKLKGHSDGISGLAFSP--DGNLLV- 304 (456)
T ss_pred EEeeccCCCeEEEEecCCCCceEEEEecCCCCEEEEecCCCcEEEEeccCCeEEEeeeccCCceEEEEECC--CCCEEE-
Confidence 99999 5567888887554 79999999875 33333 46999999999999999999988777777665 458888
Q ss_pred ecCCCCcEEEEeeCCcc---eEEeeccccc--eeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcc---ee
Q 020784 234 PGLQKGQVRVEHYASKR---TKFIMAHDSR--IACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSIS---AQ 305 (321)
Q Consensus 234 sGs~dg~V~i~d~~~~~---~~~l~~H~~~--V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~---~~ 305 (321)
+++.||.|+|||..++. ...+.++... +++++|+|+|.+|++++.|++ +++||+.+++++.++. ++.. +.
T Consensus 305 s~s~d~~i~vwd~~~~~~~~~~~~~~~~~~~~~~~~~fsp~~~~ll~~~~d~~-~~~w~l~~~~~~~~~~-~~~~~~~~~ 382 (456)
T KOG0266|consen 305 SASYDGTIRVWDLETGSKLCLKLLSGAENSAPVTSVQFSPNGKYLLSASLDRT-LKLWDLRSGKSVGTYT-GHSNLVRCI 382 (456)
T ss_pred EcCCCccEEEEECCCCceeeeecccCCCCCCceeEEEECCCCcEEEEecCCCe-EEEEEccCCcceeeec-ccCCcceeE
Confidence 47999999999998877 4577787766 999999999999999999999 9999999999999884 4443 22
Q ss_pred E--EEeecCceEEE
Q 020784 306 S--GLWLSSAWLRV 317 (321)
Q Consensus 306 ~--~~s~d~~~la~ 317 (321)
. .++..++|+..
T Consensus 383 ~~~~~~~~~~~i~s 396 (456)
T KOG0266|consen 383 FSPTLSTGGKLIYS 396 (456)
T ss_pred ecccccCCCCeEEE
Confidence 2 33466777755
No 21
>KOG1407 consensus WD40 repeat protein [Function unknown]
Probab=99.94 E-value=3e-25 Score=185.78 Aligned_cols=227 Identities=15% Similarity=0.164 Sum_probs=176.1
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeee-cCCceEEEEEec-CCCeEEEEeCCCCCCCCCCc
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFE-RGGGIGVVEMLF-RCNILALVGGGPDPQYPLNK 157 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~-~~~~v~~v~~~~-~~~~~~~~sg~~~~~~~d~~ 157 (321)
.++|..+|.+|+|+.||+.||+|+- +.++||+++..+.......+ |.+.+..++|.+ +++.+++++ .|++
T Consensus 16 ~~~~~~~v~Sv~wn~~g~~lasgs~dktv~v~n~e~~r~~~~~~~~gh~~svdql~w~~~~~d~~atas-------~dk~ 88 (313)
T KOG1407|consen 16 LQGHVQKVHSVAWNCDGTKLASGSFDKTVSVWNLERDRFRKELVYRGHTDSVDQLCWDPKHPDLFATAS-------GDKT 88 (313)
T ss_pred hhhhhhcceEEEEcccCceeeecccCCceEEEEecchhhhhhhcccCCCcchhhheeCCCCCcceEEec-------CCce
Confidence 4567789999999999999999997 55889999887655444432 455666666654 677888888 4589
Q ss_pred EEEEeCCCCcEEEEEeeCCceeEEEEeCCe--EEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEee
Q 020784 158 VMIWDDHQSRCIGELSFRSEVRSVKLRRDR--IIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCP 234 (321)
Q Consensus 158 v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~--~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~s 234 (321)
|++||.+.++++..+.....-..+.|+++. ++++. ++.|.+.|.++.+.+...+... .+.-++++ ..++.+++.
T Consensus 89 ir~wd~r~~k~~~~i~~~~eni~i~wsp~g~~~~~~~kdD~it~id~r~~~~~~~~~~~~-e~ne~~w~-~~nd~Fflt- 165 (313)
T KOG1407|consen 89 IRIWDIRSGKCTARIETKGENINITWSPDGEYIAVGNKDDRITFIDARTYKIVNEEQFKF-EVNEISWN-NSNDLFFLT- 165 (313)
T ss_pred EEEEEeccCcEEEEeeccCcceEEEEcCCCCEEEEecCcccEEEEEecccceeehhcccc-eeeeeeec-CCCCEEEEe-
Confidence 999999999999988887776677888754 33332 4699999999888776654322 12234444 333455553
Q ss_pred cCCCCcEEEEeeC-CcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCccee-EEEeecC
Q 020784 235 GLQKGQVRVEHYA-SKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQ-SGLWLSS 312 (321)
Q Consensus 235 Gs~dg~V~i~d~~-~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~-~~~s~d~ 312 (321)
+..|.|.|..+- .+++..+++|...+.||.|+|+|+|||+||.|.. +-+||+...-|++.+.+-.-..+ ++||.||
T Consensus 166 -~GlG~v~ILsypsLkpv~si~AH~snCicI~f~p~GryfA~GsADAl-vSLWD~~ELiC~R~isRldwpVRTlSFS~dg 243 (313)
T KOG1407|consen 166 -NGLGCVEILSYPSLKPVQSIKAHPSNCICIEFDPDGRYFATGSADAL-VSLWDVDELICERCISRLDWPVRTLSFSHDG 243 (313)
T ss_pred -cCCceEEEEeccccccccccccCCcceEEEEECCCCceEeeccccce-eeccChhHhhhheeeccccCceEEEEeccCc
Confidence 556899995554 5678899999999999999999999999999998 99999999999999977666654 5999999
Q ss_pred ceEEEee
Q 020784 313 AWLRVLR 319 (321)
Q Consensus 313 ~~la~~~ 319 (321)
+|||.|+
T Consensus 244 ~~lASaS 250 (313)
T KOG1407|consen 244 RMLASAS 250 (313)
T ss_pred ceeeccC
Confidence 9999875
No 22
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=99.94 E-value=7e-25 Score=186.20 Aligned_cols=195 Identities=15% Similarity=0.190 Sum_probs=161.8
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEec-CCCeEEEEeCCCCCCCCCCcEE
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLF-RCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~-~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
..+|.+-+.||.|-.|+.+|.+.+|.+..+||+++++.+..... |.+.|..+.+.+ ++|.++.++ .|+..+
T Consensus 141 l~gHtgylScC~f~dD~~ilT~SGD~TCalWDie~g~~~~~f~G-H~gDV~slsl~p~~~ntFvSg~-------cD~~ak 212 (343)
T KOG0286|consen 141 LAGHTGYLSCCRFLDDNHILTGSGDMTCALWDIETGQQTQVFHG-HTGDVMSLSLSPSDGNTFVSGG-------CDKSAK 212 (343)
T ss_pred ecCccceeEEEEEcCCCceEecCCCceEEEEEcccceEEEEecC-CcccEEEEecCCCCCCeEEecc-------ccccee
Confidence 46788999999999988766555667788999999988766665 788999999988 777776665 689999
Q ss_pred EEeCCCCcEEEEEeeCC-ceeEEEEeCCeEEEE--EC-CEEEEEEcCCcEEEEEEeccCC--CCceEEEeeCCCceEEEe
Q 020784 160 IWDDHQSRCIGELSFRS-EVRSVKLRRDRIIVV--LE-QKIFVYNFADLKLLHQIETIAN--PKGLCAVSQGVGSLVLVC 233 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~~-~v~~v~~~~~~~~~~--~~-~~I~iwd~~~~~~~~~l~~~~~--~~~~~~~s~~~d~~~la~ 233 (321)
|||++.+.++++|..+. .|.+|+|+|+....+ ++ .+.|+||++..+.+..+..... ++..++|+..+ .+|.+
T Consensus 213 lWD~R~~~c~qtF~ghesDINsv~ffP~G~afatGSDD~tcRlyDlRaD~~~a~ys~~~~~~gitSv~FS~SG--RlLfa 290 (343)
T KOG0286|consen 213 LWDVRSGQCVQTFEGHESDINSVRFFPSGDAFATGSDDATCRLYDLRADQELAVYSHDSIICGITSVAFSKSG--RLLFA 290 (343)
T ss_pred eeeccCcceeEeecccccccceEEEccCCCeeeecCCCceeEEEeecCCcEEeeeccCcccCCceeEEEcccc--cEEEe
Confidence 99999999999998765 799999999876555 34 5999999999888888875433 44556666654 77764
Q ss_pred ecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEE
Q 020784 234 PGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 234 sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd 287 (321)
|..|.++.+||.-... ...|.+|.+.|+||..+|||.-|+|||+|-+ +|||.
T Consensus 291 -gy~d~~c~vWDtlk~e~vg~L~GHeNRvScl~~s~DG~av~TgSWDs~-lriW~ 343 (343)
T KOG0286|consen 291 -GYDDFTCNVWDTLKGERVGVLAGHENRVSCLGVSPDGMAVATGSWDST-LRIWA 343 (343)
T ss_pred -eecCCceeEeeccccceEEEeeccCCeeEEEEECCCCcEEEecchhHh-eeecC
Confidence 8999999999976544 5689999999999999999999999999999 99994
No 23
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=99.94 E-value=1.8e-23 Score=183.12 Aligned_cols=224 Identities=17% Similarity=0.218 Sum_probs=175.8
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
..|.++|++++|++++++|++|+.++ +++|++.+.+....... |...+..+.+.++++.+++++ .++.|++
T Consensus 6 ~~h~~~i~~~~~~~~~~~l~~~~~~g~i~i~~~~~~~~~~~~~~-~~~~i~~~~~~~~~~~l~~~~-------~~~~i~i 77 (289)
T cd00200 6 KGHTGGVTCVAFSPDGKLLATGSGDGTIKVWDLETGELLRTLKG-HTGPVRDVAASADGTYLASGS-------SDKTIRL 77 (289)
T ss_pred cccCCCEEEEEEcCCCCEEEEeecCcEEEEEEeeCCCcEEEEec-CCcceeEEEECCCCCEEEEEc-------CCCeEEE
Confidence 36788999999999999999998654 88999988765444443 566777888888887787777 5799999
Q ss_pred EeCCCCcEEEEEeeCC-ceeEEEEeCC--eEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecC
Q 020784 161 WDDHQSRCIGELSFRS-EVRSVKLRRD--RIIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGL 236 (321)
Q Consensus 161 WD~~~~~~~~~~~~~~-~v~~v~~~~~--~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs 236 (321)
||+.+++.+..+..+. .+.++.|+++ .++++. ++.|++||+.+++.+..+..+...+..+.+++ ++.++++ |+
T Consensus 78 ~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~~~~i~~~~~~~--~~~~l~~-~~ 154 (289)
T cd00200 78 WDLETGECVRTLTGHTSYVSSVAFSPDGRILSSSSRDKTIKVWDVETGKCLTTLRGHTDWVNSVAFSP--DGTFVAS-SS 154 (289)
T ss_pred EEcCcccceEEEeccCCcEEEEEEcCCCCEEEEecCCCeEEEEECCCcEEEEEeccCCCcEEEEEEcC--cCCEEEE-Ec
Confidence 9999887777766544 7999999885 344445 67999999998888888887665555555554 4577763 67
Q ss_pred CCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCc--ceeEEEeecCc
Q 020784 237 QKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSI--SAQSGLWLSSA 313 (321)
Q Consensus 237 ~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~--~~~~~~s~d~~ 313 (321)
.+|.|++||..... ...+..|...|++++|+|+++.|++++.|+. |++||+++++.+.++. ++. ...+.+++++.
T Consensus 155 ~~~~i~i~d~~~~~~~~~~~~~~~~i~~~~~~~~~~~l~~~~~~~~-i~i~d~~~~~~~~~~~-~~~~~i~~~~~~~~~~ 232 (289)
T cd00200 155 QDGTIKLWDLRTGKCVATLTGHTGEVNSVAFSPDGEKLLSSSSDGT-IKLWDLSTGKCLGTLR-GHENGVNSVAFSPDGY 232 (289)
T ss_pred CCCcEEEEEccccccceeEecCccccceEEECCCcCEEEEecCCCc-EEEEECCCCceecchh-hcCCceEEEEEcCCCc
Confidence 79999999997544 6688899999999999999999999999999 9999999999988873 333 33346666667
Q ss_pred eEEEe
Q 020784 314 WLRVL 318 (321)
Q Consensus 314 ~la~~ 318 (321)
+++++
T Consensus 233 ~~~~~ 237 (289)
T cd00200 233 LLASG 237 (289)
T ss_pred EEEEE
Confidence 77665
No 24
>KOG0265 consensus U5 snRNP-specific protein-like factor and related proteins [RNA processing and modification]
Probab=99.94 E-value=1.3e-24 Score=185.12 Aligned_cols=205 Identities=16% Similarity=0.202 Sum_probs=159.2
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCC-cEEEEEecCC-ceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcE
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDH-GFRIYNCDPF-REIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~-gv~vw~~~~~-~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
..+|++.|+.+.|+|+|.+||+|+.| .|.+|++... +-...... |.+.|.-+.+..+++.+..++ .|++|
T Consensus 43 l~gh~geI~~~~F~P~gs~~aSgG~Dr~I~LWnv~gdceN~~~lkg-HsgAVM~l~~~~d~s~i~S~g-------tDk~v 114 (338)
T KOG0265|consen 43 LPGHKGEIYTIKFHPDGSCFASGGSDRAIVLWNVYGDCENFWVLKG-HSGAVMELHGMRDGSHILSCG-------TDKTV 114 (338)
T ss_pred cCCCcceEEEEEECCCCCeEeecCCcceEEEEeccccccceeeecc-ccceeEeeeeccCCCEEEEec-------CCceE
Confidence 35788999999999999999998874 5889996432 22223333 678888888889999998888 78999
Q ss_pred EEEeCCCCcEEEEEeeCCc-eeEEEEeCC---eEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEe
Q 020784 159 MIWDDHQSRCIGELSFRSE-VRSVKLRRD---RIIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVC 233 (321)
Q Consensus 159 ~iWD~~~~~~~~~~~~~~~-v~~v~~~~~---~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~ 233 (321)
+.||+++|+++..++.+.. |.+++.... .+..++ |+++|+||+++.+.++++... ..+.++.+..+..-+.
T Consensus 115 ~~wD~~tG~~~rk~k~h~~~vNs~~p~rrg~~lv~SgsdD~t~kl~D~R~k~~~~t~~~k---yqltAv~f~d~s~qv~- 190 (338)
T KOG0265|consen 115 RGWDAETGKRIRKHKGHTSFVNSLDPSRRGPQLVCSGSDDGTLKLWDIRKKEAIKTFENK---YQLTAVGFKDTSDQVI- 190 (338)
T ss_pred EEEecccceeeehhccccceeeecCccccCCeEEEecCCCceEEEEeecccchhhccccc---eeEEEEEeccccccee-
Confidence 9999999999998887764 444543322 222333 369999999998888877532 3355666655544454
Q ss_pred ecCCCCcEEEEeeCCc-ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCC----CcEEEEEe
Q 020784 234 PGLQKGQVRVEHYASK-RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLD----GTLLQEEC 298 (321)
Q Consensus 234 sGs~dg~V~i~d~~~~-~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~t----g~~i~~~~ 298 (321)
+|.-|+.|++||+... .++++.||...|+.|..+++|.++.+-++|.+ +|+||++- ..|+..+.
T Consensus 191 sggIdn~ikvWd~r~~d~~~~lsGh~DtIt~lsls~~gs~llsnsMd~t-vrvwd~rp~~p~~R~v~if~ 259 (338)
T KOG0265|consen 191 SGGIDNDIKVWDLRKNDGLYTLSGHADTITGLSLSRYGSFLLSNSMDNT-VRVWDVRPFAPSQRCVKIFQ 259 (338)
T ss_pred eccccCceeeeccccCcceEEeecccCceeeEEeccCCCccccccccce-EEEEEecccCCCCceEEEee
Confidence 5999999999998654 47899999999999999999999999999999 99999985 34566664
No 25
>KOG0285 consensus Pleiotropic regulator 1 [RNA processing and modification]
Probab=99.93 E-value=8.9e-25 Score=190.00 Aligned_cols=218 Identities=16% Similarity=0.171 Sum_probs=180.3
Q ss_pred CcccCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCC
Q 020784 78 ESTSSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLN 156 (321)
Q Consensus 78 ~~~~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~ 156 (321)
+..-..|.+=|+||++.|-.++|++|+.|+ ++|||+.+++....... |...+..++++..-.++..++ .|+
T Consensus 144 ~rVi~gHlgWVr~vavdP~n~wf~tgs~DrtikIwDlatg~LkltltG-hi~~vr~vavS~rHpYlFs~g-------edk 215 (460)
T KOG0285|consen 144 YRVISGHLGWVRSVAVDPGNEWFATGSADRTIKIWDLATGQLKLTLTG-HIETVRGVAVSKRHPYLFSAG-------EDK 215 (460)
T ss_pred hhhhhhccceEEEEeeCCCceeEEecCCCceeEEEEcccCeEEEeecc-hhheeeeeeecccCceEEEec-------CCC
Confidence 334467889999999999999999999855 77999999998777764 567788888888888888887 689
Q ss_pred cEEEEeCCCCcEEEEEeeC-CceeEEEEeCCe--EEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEE
Q 020784 157 KVMIWDDHQSRCIGELSFR-SEVRSVKLRRDR--IIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLV 232 (321)
Q Consensus 157 ~v~iWD~~~~~~~~~~~~~-~~v~~v~~~~~~--~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la 232 (321)
.||-||++..+.++....+ +.|+++..+|.. ++.++ |.++|+||+++...++.+.+|.+++..+.+.+. |.+++
T Consensus 216 ~VKCwDLe~nkvIR~YhGHlS~V~~L~lhPTldvl~t~grDst~RvWDiRtr~~V~~l~GH~~~V~~V~~~~~-dpqvi- 293 (460)
T KOG0285|consen 216 QVKCWDLEYNKVIRHYHGHLSGVYCLDLHPTLDVLVTGGRDSTIRVWDIRTRASVHVLSGHTNPVASVMCQPT-DPQVI- 293 (460)
T ss_pred eeEEEechhhhhHHHhccccceeEEEeccccceeEEecCCcceEEEeeecccceEEEecCCCCcceeEEeecC-CCceE-
Confidence 9999999999988877655 579999999753 44443 469999999999999999999998876665543 22444
Q ss_pred eecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEe
Q 020784 233 CPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLW 309 (321)
Q Consensus 233 ~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s 309 (321)
+|+.|++|++||+..+. ..++..|+..|++++.+|....|||+|.| .|+-|++..|+.++.+ .++...+..++
T Consensus 294 -t~S~D~tvrlWDl~agkt~~tlt~hkksvral~lhP~e~~fASas~d--nik~w~~p~g~f~~nl-sgh~~iintl~ 367 (460)
T KOG0285|consen 294 -TGSHDSTVRLWDLRAGKTMITLTHHKKSVRALCLHPKENLFASASPD--NIKQWKLPEGEFLQNL-SGHNAIINTLS 367 (460)
T ss_pred -EecCCceEEEeeeccCceeEeeecccceeeEEecCCchhhhhccCCc--cceeccCCccchhhcc-ccccceeeeee
Confidence 59999999999998765 67999999999999999999999999988 3799999999999886 46666655554
No 26
>KOG0293 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.93 E-value=4.1e-25 Score=195.11 Aligned_cols=199 Identities=15% Similarity=0.183 Sum_probs=147.5
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCce---eEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCc
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFRE---IFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNK 157 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~---~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~ 157 (321)
..|.++|.-+.||++|+|||+++.+. ..||.+..... ..+... |..+|..+.|+|+.+++++++ .+..
T Consensus 221 ~~htdEVWfl~FS~nGkyLAsaSkD~Taiiw~v~~d~~~kl~~tlvg-h~~~V~yi~wSPDdryLlaCg-------~~e~ 292 (519)
T KOG0293|consen 221 QDHTDEVWFLQFSHNGKYLASASKDSTAIIWIVVYDVHFKLKKTLVG-HSQPVSYIMWSPDDRYLLACG-------FDEV 292 (519)
T ss_pred hhCCCcEEEEEEcCCCeeEeeccCCceEEEEEEecCcceeeeeeeec-ccCceEEEEECCCCCeEEecC-------chHh
Confidence 57889999999999999999999855 66998755443 223332 678899999999999998888 4455
Q ss_pred EEEEeCCCCcEEEEEeeC--CceeEEEEeCC-------------------------------------------------
Q 020784 158 VMIWDDHQSRCIGELSFR--SEVRSVKLRRD------------------------------------------------- 186 (321)
Q Consensus 158 v~iWD~~~~~~~~~~~~~--~~v~~v~~~~~------------------------------------------------- 186 (321)
+++||+.+|.+...+... ..+.+++|.++
T Consensus 293 ~~lwDv~tgd~~~~y~~~~~~S~~sc~W~pDg~~~V~Gs~dr~i~~wdlDgn~~~~W~gvr~~~v~dlait~Dgk~vl~v 372 (519)
T KOG0293|consen 293 LSLWDVDTGDLRHLYPSGLGFSVSSCAWCPDGFRFVTGSPDRTIIMWDLDGNILGNWEGVRDPKVHDLAITYDGKYVLLV 372 (519)
T ss_pred eeeccCCcchhhhhcccCcCCCcceeEEccCCceeEecCCCCcEEEecCCcchhhcccccccceeEEEEEcCCCcEEEEE
Confidence 777777776655444322 24444444433
Q ss_pred -----------------------------------eEEEE--ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCc-
Q 020784 187 -----------------------------------RIIVV--LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGS- 228 (321)
Q Consensus 187 -----------------------------------~~~~~--~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~- 228 (321)
++++. .+..|++||+...++++++.+|.....++.-++.+.+
T Consensus 373 ~~d~~i~l~~~e~~~dr~lise~~~its~~iS~d~k~~LvnL~~qei~LWDl~e~~lv~kY~Ghkq~~fiIrSCFgg~~~ 452 (519)
T KOG0293|consen 373 TVDKKIRLYNREARVDRGLISEEQPITSFSISKDGKLALVNLQDQEIHLWDLEENKLVRKYFGHKQGHFIIRSCFGGGND 452 (519)
T ss_pred ecccceeeechhhhhhhccccccCceeEEEEcCCCcEEEEEcccCeeEEeecchhhHHHHhhcccccceEEEeccCCCCc
Confidence 11111 2356777887777777777777776666666666555
Q ss_pred eEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCC-CCEEEEEeCCCcEEEEEEcCC
Q 020784 229 LVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQD-GQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 229 ~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspd-g~~las~S~Dgt~IrIWd~~t 290 (321)
.++| ||+.|+.|+||+...+. +.++.||...|+||+|+|. -.+|||||+||| ||||-...
T Consensus 453 ~fia-SGSED~kvyIWhr~sgkll~~LsGHs~~vNcVswNP~~p~m~ASasDDgt-IRIWg~~~ 514 (519)
T KOG0293|consen 453 KFIA-SGSEDSKVYIWHRISGKLLAVLSGHSKTVNCVSWNPADPEMFASASDDGT-IRIWGPSD 514 (519)
T ss_pred ceEE-ecCCCceEEEEEccCCceeEeecCCcceeeEEecCCCCHHHhhccCCCCe-EEEecCCc
Confidence 4555 89999999999987765 6799999999999999986 468999999999 99997653
No 27
>KOG0284 consensus Polyadenylation factor I complex, subunit PFS2 [RNA processing and modification]
Probab=99.93 E-value=7.9e-26 Score=199.33 Aligned_cols=213 Identities=10% Similarity=0.108 Sum_probs=171.7
Q ss_pred CCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC
Q 020784 86 PTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH 164 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~ 164 (321)
.+|..|+|.|+|+.|++|+..| +-+|+...+..+..... |+..|..++|+.++..++.+. .+|.||+|+..
T Consensus 97 c~V~~v~WtPeGRRLltgs~SGEFtLWNg~~fnFEtilQa-HDs~Vr~m~ws~~g~wmiSgD-------~gG~iKyWqpn 168 (464)
T KOG0284|consen 97 CPVNVVRWTPEGRRLLTGSQSGEFTLWNGTSFNFETILQA-HDSPVRTMKWSHNGTWMISGD-------KGGMIKYWQPN 168 (464)
T ss_pred cceeeEEEcCCCceeEeecccccEEEecCceeeHHHHhhh-hcccceeEEEccCCCEEEEcC-------CCceEEecccc
Confidence 4899999999999999999977 66999865544333333 799999999999998776655 56999999987
Q ss_pred CCcEEEEEeeC-CceeEEEEeCC--eEEEEEC-CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCc
Q 020784 165 QSRCIGELSFR-SEVRSVKLRRD--RIIVVLE-QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQ 240 (321)
Q Consensus 165 ~~~~~~~~~~~-~~v~~v~~~~~--~~~~~~~-~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~ 240 (321)
.........++ ..|++++|+++ .++.|++ ++|+|||+...+.-+.+.+|...+.++++++. ..++| +|+.|..
T Consensus 169 mnnVk~~~ahh~eaIRdlafSpnDskF~t~SdDg~ikiWdf~~~kee~vL~GHgwdVksvdWHP~--kgLia-sgskDnl 245 (464)
T KOG0284|consen 169 MNNVKIIQAHHAEAIRDLAFSPNDSKFLTCSDDGTIKIWDFRMPKEERVLRGHGWDVKSVDWHPT--KGLIA-SGSKDNL 245 (464)
T ss_pred hhhhHHhhHhhhhhhheeccCCCCceeEEecCCCeEEEEeccCCchhheeccCCCCcceeccCCc--cceeE-EccCCce
Confidence 65443333334 58999999874 4555654 69999999888877888888887777777664 36666 6999999
Q ss_pred EEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeec
Q 020784 241 VRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLS 311 (321)
Q Consensus 241 V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d 311 (321)
|++||-+++. +.++.+|+..|..+.|++++.+|+|+|.|.. +|+||+++.+.+.++ ++|.+...++.+.
T Consensus 246 VKlWDprSg~cl~tlh~HKntVl~~~f~~n~N~Llt~skD~~-~kv~DiR~mkEl~~~-r~Hkkdv~~~~Wh 315 (464)
T KOG0284|consen 246 VKLWDPRSGSCLATLHGHKNTVLAVKFNPNGNWLLTGSKDQS-CKVFDIRTMKELFTY-RGHKKDVTSLTWH 315 (464)
T ss_pred eEeecCCCcchhhhhhhccceEEEEEEcCCCCeeEEccCCce-EEEEehhHhHHHHHh-hcchhhheeeccc
Confidence 9999988765 7799999999999999999999999999999 999999998888887 5777665555433
No 28
>KOG0295 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.93 E-value=2.4e-24 Score=187.63 Aligned_cols=247 Identities=14% Similarity=0.179 Sum_probs=190.5
Q ss_pred CCCCCCCCCCCCCCCCCCCCCcccCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEe
Q 020784 58 FSPSIPESNPNYQMPLPSPAESTSSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEML 136 (321)
Q Consensus 58 ~~p~~~~~~~~~~~~~~~~~~~~~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~ 136 (321)
+.|...+..+..+-+.+.....+ ..|+.+|+.+-|+|+--..+++++++ +++||..+++.+..... |...+..+.+.
T Consensus 82 g~pt~~~~~~~~wipRp~l~~~l-~g~r~~vt~v~~hp~~~~v~~as~d~tikv~D~~tg~~e~~LrG-Ht~sv~di~~~ 159 (406)
T KOG0295|consen 82 GDPTGSKRTPALWIPRPNLVQKL-AGHRSSVTRVIFHPSEALVVSASEDATIKVFDTETGELERSLRG-HTDSVFDISFD 159 (406)
T ss_pred CCCCcCccChhhcCCCCCchhhh-hccccceeeeeeccCceEEEEecCCceEEEEEccchhhhhhhhc-cccceeEEEEe
Confidence 34443333344444443223333 34888999999999999999998855 88999999988555444 66778888888
Q ss_pred cCCCeEEEEeCCCCCCCCCCcEEEEeCCC-CcEEEEEee-CCceeEEEEeC--CeEEEEE-CCEEEEEEcCCcEEEEEEe
Q 020784 137 FRCNILALVGGGPDPQYPLNKVMIWDDHQ-SRCIGELSF-RSEVRSVKLRR--DRIIVVL-EQKIFVYNFADLKLLHQIE 211 (321)
Q Consensus 137 ~~~~~~~~~sg~~~~~~~d~~v~iWD~~~-~~~~~~~~~-~~~v~~v~~~~--~~~~~~~-~~~I~iwd~~~~~~~~~l~ 211 (321)
..+..++.++ .|=.+++||.++ .+++..... ...|.+++|-+ +.++.++ |++|+.|++.++.++++|.
T Consensus 160 a~Gk~l~tcS-------sDl~~~LWd~~~~~~c~ks~~gh~h~vS~V~f~P~gd~ilS~srD~tik~We~~tg~cv~t~~ 232 (406)
T KOG0295|consen 160 ASGKYLATCS-------SDLSAKLWDFDTFFRCIKSLIGHEHGVSSVFFLPLGDHILSCSRDNTIKAWECDTGYCVKTFP 232 (406)
T ss_pred cCccEEEecC-------CccchhheeHHHHHHHHHHhcCcccceeeEEEEecCCeeeecccccceeEEecccceeEEecc
Confidence 8888888888 556699999987 445554444 44678888876 4555554 5799999999999999999
Q ss_pred ccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCC---------------CCEEEE
Q 020784 212 TIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQD---------------GQLLAT 275 (321)
Q Consensus 212 ~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspd---------------g~~las 275 (321)
+|...+.++.+. .|+.++| +++.|.+|++|-..++. ...++.|..+|-|++|-|. |+++++
T Consensus 233 ~h~ewvr~v~v~--~DGti~A-s~s~dqtl~vW~~~t~~~k~~lR~hEh~vEci~wap~~~~~~i~~at~~~~~~~~l~s 309 (406)
T KOG0295|consen 233 GHSEWVRMVRVN--QDGTIIA-SCSNDQTLRVWVVATKQCKAELREHEHPVECIAWAPESSYPSISEATGSTNGGQVLGS 309 (406)
T ss_pred CchHhEEEEEec--CCeeEEE-ecCCCceEEEEEeccchhhhhhhccccceEEEEecccccCcchhhccCCCCCccEEEe
Confidence 998877666654 5668998 69999999999998876 4589999999999999763 258999
Q ss_pred EeCCCcEEEEEEcCCCcEEEEEeCCCccee--EEEeecCceEEEe
Q 020784 276 SSTKGTLVRIFNTLDGTLLQEECCPSISAQ--SGLWLSSAWLRVL 318 (321)
Q Consensus 276 ~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~--~~~s~d~~~la~~ 318 (321)
+|.|++ ||+||+.+|+|+-++ .||++-+ ++|++-|+||+-+
T Consensus 310 ~SrDkt-Ik~wdv~tg~cL~tL-~ghdnwVr~~af~p~Gkyi~Sc 352 (406)
T KOG0295|consen 310 GSRDKT-IKIWDVSTGMCLFTL-VGHDNWVRGVAFSPGGKYILSC 352 (406)
T ss_pred ecccce-EEEEeccCCeEEEEE-ecccceeeeeEEcCCCeEEEEE
Confidence 999999 999999999999999 5777644 4667779998764
No 29
>PTZ00421 coronin; Provisional
Probab=99.92 E-value=1.2e-22 Score=193.48 Aligned_cols=217 Identities=17% Similarity=0.246 Sum_probs=158.6
Q ss_pred cCCCCCCeEEEEEcC-CCCEEEEEcCCc-EEEEEecCCce-------eEEeeeecCCceEEEEEecCC-CeEEEEeCCCC
Q 020784 81 SSSPPPTLLHISFNQ-DHGCFAAGTDHG-FRIYNCDPFRE-------IFRRDFERGGGIGVVEMLFRC-NILALVGGGPD 150 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~-dg~~lasg~~~g-v~vw~~~~~~~-------~~~~~~~~~~~v~~v~~~~~~-~~~~~~sg~~~ 150 (321)
..+|.+.|++++|+| |+++|++|+.|+ |+|||+.+.+. +..... |...|..++|++.. +.+++++
T Consensus 71 l~GH~~~V~~v~fsP~d~~~LaSgS~DgtIkIWdi~~~~~~~~~~~~l~~L~g-H~~~V~~l~f~P~~~~iLaSgs---- 145 (493)
T PTZ00421 71 LLGQEGPIIDVAFNPFDPQKLFTASEDGTIMGWGIPEEGLTQNISDPIVHLQG-HTKKVGIVSFHPSAMNVLASAG---- 145 (493)
T ss_pred EeCCCCCEEEEEEcCCCCCEEEEEeCCCEEEEEecCCCccccccCcceEEecC-CCCcEEEEEeCcCCCCEEEEEe----
Confidence 457888999999999 899999999866 88999976431 222332 67789999998875 5676666
Q ss_pred CCCCCCcEEEEeCCCCcEEEEEeeC-CceeEEEEeCCe--EEEEE-CCEEEEEEcCCcEEEEEEeccCCCCc-eEEEeeC
Q 020784 151 PQYPLNKVMIWDDHQSRCIGELSFR-SEVRSVKLRRDR--IIVVL-EQKIFVYNFADLKLLHQIETIANPKG-LCAVSQG 225 (321)
Q Consensus 151 ~~~~d~~v~iWD~~~~~~~~~~~~~-~~v~~v~~~~~~--~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~-~~~~s~~ 225 (321)
.|++|+|||+++++.+..+..+ ..|.+++|+++. +++++ +++|++||+++++.+.++..|..... .+.+.++
T Consensus 146 ---~DgtVrIWDl~tg~~~~~l~~h~~~V~sla~spdG~lLatgs~Dg~IrIwD~rsg~~v~tl~~H~~~~~~~~~w~~~ 222 (493)
T PTZ00421 146 ---ADMVVNVWDVERGKAVEVIKCHSDQITSLEWNLDGSLLCTTSKDKKLNIIDPRDGTIVSSVEAHASAKSQRCLWAKR 222 (493)
T ss_pred ---CCCEEEEEECCCCeEEEEEcCCCCceEEEEEECCCCEEEEecCCCEEEEEECCCCcEEEEEecCCCCcceEEEEcCC
Confidence 6799999999999888777644 579999999764 44443 57999999999999999888765433 3334433
Q ss_pred CCceEEEeec---CCCCcEEEEeeCCc--ceEEeecc-ccceeEEEECCCCCEEEEEeC-CCcEEEEEEcCCCcEEEEEe
Q 020784 226 VGSLVLVCPG---LQKGQVRVEHYASK--RTKFIMAH-DSRIACFALTQDGQLLATSST-KGTLVRIFNTLDGTLLQEEC 298 (321)
Q Consensus 226 ~d~~~la~sG---s~dg~V~i~d~~~~--~~~~l~~H-~~~V~~vafspdg~~las~S~-Dgt~IrIWd~~tg~~i~~~~ 298 (321)
+..++++| +.|+.|++||+... ++.....| ...+....|++++.+|++|+. |++ ||+||+.+++++..+.
T Consensus 223 --~~~ivt~G~s~s~Dr~VklWDlr~~~~p~~~~~~d~~~~~~~~~~d~d~~~L~lggkgDg~-Iriwdl~~~~~~~~~~ 299 (493)
T PTZ00421 223 --KDLIITLGCSKSQQRQIMLWDTRKMASPYSTVDLDQSSALFIPFFDEDTNLLYIGSKGEGN-IRCFELMNERLTFCSS 299 (493)
T ss_pred --CCeEEEEecCCCCCCeEEEEeCCCCCCceeEeccCCCCceEEEEEcCCCCEEEEEEeCCCe-EEEEEeeCCceEEEee
Confidence 33444334 45899999998753 33444433 345666789999999998874 998 9999999999887765
Q ss_pred CCCcceeEEE
Q 020784 299 CPSISAQSGL 308 (321)
Q Consensus 299 ~g~~~~~~~~ 308 (321)
..+......+
T Consensus 300 ~~s~~~~~g~ 309 (493)
T PTZ00421 300 YSSVEPHKGL 309 (493)
T ss_pred ccCCCCCcce
Confidence 4444333333
No 30
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.92 E-value=5e-24 Score=176.17 Aligned_cols=205 Identities=15% Similarity=0.195 Sum_probs=165.5
Q ss_pred CCCCCCeEEEEEcCCCCEEE-EEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 82 SSPPPTLLHISFNQDHGCFA-AGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~la-sg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
..+++.|+.+.|+-||+|.+ +|++++|++||...+..+..+.. |++.|..++.+++...++.++ .|+.|.+
T Consensus 14 ~~~qgaV~avryN~dGnY~ltcGsdrtvrLWNp~rg~liktYsg-hG~EVlD~~~s~Dnskf~s~G-------gDk~v~v 85 (307)
T KOG0316|consen 14 DCAQGAVRAVRYNVDGNYCLTCGSDRTVRLWNPLRGALIKTYSG-HGHEVLDAALSSDNSKFASCG-------GDKAVQV 85 (307)
T ss_pred cccccceEEEEEccCCCEEEEcCCCceEEeecccccceeeeecC-CCceeeeccccccccccccCC-------CCceEEE
Confidence 45778999999999999855 66678999999988887766665 778888888888888887766 3699999
Q ss_pred EeCCCCcEEEEEeeCC-ceeEEEEeCCeEEEEE---CCEEEEEEcC--CcEEEEEEeccCCCCceEEEeeCCCceEEEee
Q 020784 161 WDDHQSRCIGELSFRS-EVRSVKLRRDRIIVVL---EQKIFVYNFA--DLKLLHQIETIANPKGLCAVSQGVGSLVLVCP 234 (321)
Q Consensus 161 WD~~~~~~~~~~~~~~-~v~~v~~~~~~~~~~~---~~~I~iwd~~--~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~s 234 (321)
||+.+|+.++.+..+. .|..+.|+.+.-++++ |.++|+||-+ ..+.++.|......+..+.++-+ .+++
T Consensus 86 wDV~TGkv~Rr~rgH~aqVNtV~fNeesSVv~SgsfD~s~r~wDCRS~s~ePiQildea~D~V~Si~v~~h---eIva-- 160 (307)
T KOG0316|consen 86 WDVNTGKVDRRFRGHLAQVNTVRFNEESSVVASGSFDSSVRLWDCRSRSFEPIQILDEAKDGVSSIDVAEH---EIVA-- 160 (307)
T ss_pred EEcccCeeeeecccccceeeEEEecCcceEEEeccccceeEEEEcccCCCCccchhhhhcCceeEEEeccc---EEEe--
Confidence 9999999999998764 8999999987655554 4699999985 57888888776655555555543 4554
Q ss_pred cCCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCc
Q 020784 235 GLQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSI 302 (321)
Q Consensus 235 Gs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~ 302 (321)
|+.||+++.+|+..+.+.. .....+|+|++|++||+-+..++.|++ +|+.|-.||++++.|+ ||.
T Consensus 161 GS~DGtvRtydiR~G~l~s-Dy~g~pit~vs~s~d~nc~La~~l~st-lrLlDk~tGklL~sYk-Ghk 225 (307)
T KOG0316|consen 161 GSVDGTVRTYDIRKGTLSS-DYFGHPITSVSFSKDGNCSLASSLDST-LRLLDKETGKLLKSYK-GHK 225 (307)
T ss_pred eccCCcEEEEEeecceeeh-hhcCCcceeEEecCCCCEEEEeeccce-eeecccchhHHHHHhc-ccc
Confidence 9999999999998776542 334568999999999999888999999 9999999999987773 444
No 31
>PLN00181 protein SPA1-RELATED; Provisional
Probab=99.92 E-value=1.3e-22 Score=205.64 Aligned_cols=224 Identities=16% Similarity=0.177 Sum_probs=167.0
Q ss_pred CCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCc----ee--EEeeeecCCceEEEEEec-CCCeEEEEeCCCCCCCC
Q 020784 83 SPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFR----EI--FRRDFERGGGIGVVEMLF-RCNILALVGGGPDPQYP 154 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~----~~--~~~~~~~~~~v~~v~~~~-~~~~~~~~sg~~~~~~~ 154 (321)
.|.+.|.+++|++||++||+|+.++ |+||++.... .. ......+...+..++|.+ .+..+++++ .
T Consensus 481 ~~~~~V~~i~fs~dg~~latgg~D~~I~iwd~~~~~~~~~~~~~~~~~~~~~~~v~~l~~~~~~~~~las~~-------~ 553 (793)
T PLN00181 481 NSSNLVCAIGFDRDGEFFATAGVNKKIKIFECESIIKDGRDIHYPVVELASRSKLSGICWNSYIKSQVASSN-------F 553 (793)
T ss_pred CCCCcEEEEEECCCCCEEEEEeCCCEEEEEECCcccccccccccceEEecccCceeeEEeccCCCCEEEEEe-------C
Confidence 4778999999999999999999755 8899975321 00 011111245667777765 356666666 6
Q ss_pred CCcEEEEeCCCCcEEEEEeeC-CceeEEEEeC-C--eEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCce
Q 020784 155 LNKVMIWDDHQSRCIGELSFR-SEVRSVKLRR-D--RIIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSL 229 (321)
Q Consensus 155 d~~v~iWD~~~~~~~~~~~~~-~~v~~v~~~~-~--~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~ 229 (321)
|++|+|||+.+++.+..+..+ ..|++++|++ + .+++++ +++|++||+++++.+.++..+. .+..+.+. .+++.
T Consensus 554 Dg~v~lWd~~~~~~~~~~~~H~~~V~~l~~~p~~~~~L~Sgs~Dg~v~iWd~~~~~~~~~~~~~~-~v~~v~~~-~~~g~ 631 (793)
T PLN00181 554 EGVVQVWDVARSQLVTEMKEHEKRVWSIDYSSADPTLLASGSDDGSVKLWSINQGVSIGTIKTKA-NICCVQFP-SESGR 631 (793)
T ss_pred CCeEEEEECCCCeEEEEecCCCCCEEEEEEcCCCCCEEEEEcCCCEEEEEECCCCcEEEEEecCC-CeEEEEEe-CCCCC
Confidence 799999999999888877654 5799999985 3 345554 5799999999998888887542 23333332 23567
Q ss_pred EEEeecCCCCcEEEEeeCCc--ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCC------cEEEEEeCCC
Q 020784 230 VLVCPGLQKGQVRVEHYASK--RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDG------TLLQEECCPS 301 (321)
Q Consensus 230 ~la~sGs~dg~V~i~d~~~~--~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg------~~i~~~~~g~ 301 (321)
+++ +|+.||.|++||.... .+.++.+|...|++++|. ++.+|+|+|.|++ |+|||+..+ ++++++. +|
T Consensus 632 ~la-tgs~dg~I~iwD~~~~~~~~~~~~~h~~~V~~v~f~-~~~~lvs~s~D~~-ikiWd~~~~~~~~~~~~l~~~~-gh 707 (793)
T PLN00181 632 SLA-FGSADHKVYYYDLRNPKLPLCTMIGHSKTVSYVRFV-DSSTLVSSSTDNT-LKLWDLSMSISGINETPLHSFM-GH 707 (793)
T ss_pred EEE-EEeCCCeEEEEECCCCCccceEecCCCCCEEEEEEe-CCCEEEEEECCCE-EEEEeCCCCccccCCcceEEEc-CC
Confidence 777 4999999999998764 356788999999999997 7889999999999 999999853 5677774 55
Q ss_pred cce--eEEEeecCceEEEee
Q 020784 302 ISA--QSGLWLSSAWLRVLR 319 (321)
Q Consensus 302 ~~~--~~~~s~d~~~la~~~ 319 (321)
... .+.+++++.|||++.
T Consensus 708 ~~~i~~v~~s~~~~~lasgs 727 (793)
T PLN00181 708 TNVKNFVGLSVSDGYIATGS 727 (793)
T ss_pred CCCeeEEEEcCCCCEEEEEe
Confidence 543 357788899998864
No 32
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=99.92 E-value=5.6e-23 Score=195.50 Aligned_cols=223 Identities=17% Similarity=0.229 Sum_probs=173.8
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCC-cEEEEEe-cCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDH-GFRIYNC-DPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~-gv~vw~~-~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
..|...|++++|+|||+++++|++| +++|||+ +.+..+..... |...+.++++.+.+++++.++ .|++||
T Consensus 200 ~~h~~~v~~~~fs~d~~~l~s~s~D~tiriwd~~~~~~~~~~l~g-H~~~v~~~~f~p~g~~i~Sgs-------~D~tvr 271 (456)
T KOG0266|consen 200 SGHTRGVSDVAFSPDGSYLLSGSDDKTLRIWDLKDDGRNLKTLKG-HSTYVTSVAFSPDGNLLVSGS-------DDGTVR 271 (456)
T ss_pred cccccceeeeEECCCCcEEEEecCCceEEEeeccCCCeEEEEecC-CCCceEEEEecCCCCEEEEec-------CCCcEE
Confidence 4678899999999999999999985 5889999 44455555543 788899999999997777766 689999
Q ss_pred EEeCCCCcEEEEEeeCC-ceeEEEEeCCe--EEEEE-CCEEEEEEcCCcE--EEEEEeccCCC--CceEEEeeCCCceEE
Q 020784 160 IWDDHQSRCIGELSFRS-EVRSVKLRRDR--IIVVL-EQKIFVYNFADLK--LLHQIETIANP--KGLCAVSQGVGSLVL 231 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~~-~v~~v~~~~~~--~~~~~-~~~I~iwd~~~~~--~~~~l~~~~~~--~~~~~~s~~~d~~~l 231 (321)
|||+++++++..+..+. .|.+++|.++. +++++ ++.|++||+.+++ +++.+..+... +..+.++ +++.++
T Consensus 272 iWd~~~~~~~~~l~~hs~~is~~~f~~d~~~l~s~s~d~~i~vwd~~~~~~~~~~~~~~~~~~~~~~~~~fs--p~~~~l 349 (456)
T KOG0266|consen 272 IWDVRTGECVRKLKGHSDGISGLAFSPDGNLLVSASYDGTIRVWDLETGSKLCLKLLSGAENSAPVTSVQFS--PNGKYL 349 (456)
T ss_pred EEeccCCeEEEeeeccCCceEEEEECCCCCEEEEcCCCccEEEEECCCCceeeeecccCCCCCCceeEEEEC--CCCcEE
Confidence 99999999999998776 78999998864 33333 5799999999998 56777766554 4445555 455777
Q ss_pred EeecCCCCcEEEEeeCCcc-eEEeeccccce---eEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCC-cceeE
Q 020784 232 VCPGLQKGQVRVEHYASKR-TKFIMAHDSRI---ACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPS-ISAQS 306 (321)
Q Consensus 232 a~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V---~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~-~~~~~ 306 (321)
+ ++..|+.+++|++.... ...+.+|...+ .+..+++.|.++.+|++|+. |++||+.++..+..+. +| ...+.
T Consensus 350 l-~~~~d~~~~~w~l~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~i~sg~~d~~-v~~~~~~s~~~~~~l~-~h~~~~~~ 426 (456)
T KOG0266|consen 350 L-SASLDRTLKLWDLRSGKSVGTYTGHSNLVRCIFSPTLSTGGKLIYSGSEDGS-VYVWDSSSGGILQRLE-GHSKAAVS 426 (456)
T ss_pred E-EecCCCeEEEEEccCCcceeeecccCCcceeEecccccCCCCeEEEEeCCce-EEEEeCCccchhhhhc-CCCCCcee
Confidence 7 48999999999998654 67888988754 34455788999999999999 9999999998888774 55 44433
Q ss_pred --EEeecCceEEE
Q 020784 307 --GLWLSSAWLRV 317 (321)
Q Consensus 307 --~~s~d~~~la~ 317 (321)
.+.+...+++.
T Consensus 427 ~~~~~~~~~~~~s 439 (456)
T KOG0266|consen 427 DLSSHPTENLIAS 439 (456)
T ss_pred ccccCCCcCeeee
Confidence 44455566554
No 33
>KOG0284 consensus Polyadenylation factor I complex, subunit PFS2 [RNA processing and modification]
Probab=99.92 E-value=4.3e-25 Score=194.69 Aligned_cols=228 Identities=11% Similarity=0.057 Sum_probs=181.7
Q ss_pred cccCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCc
Q 020784 79 STSSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNK 157 (321)
Q Consensus 79 ~~~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~ 157 (321)
.+...|..+|+++.|+.+|+++++|+.+| |++|+..-........+ |...|+.+++++....+++++ +|++
T Consensus 132 tilQaHDs~Vr~m~ws~~g~wmiSgD~gG~iKyWqpnmnnVk~~~ah-h~eaIRdlafSpnDskF~t~S-------dDg~ 203 (464)
T KOG0284|consen 132 TILQAHDSPVRTMKWSHNGTWMISGDKGGMIKYWQPNMNNVKIIQAH-HAEAIRDLAFSPNDSKFLTCS-------DDGT 203 (464)
T ss_pred HHhhhhcccceeEEEccCCCEEEEcCCCceEEecccchhhhHHhhHh-hhhhhheeccCCCCceeEEec-------CCCe
Confidence 34467999999999999999999999988 67997543322222222 457899999999888888888 7899
Q ss_pred EEEEeCCCCcEEEEEeeCC-ceeEEEEeCCeEEEE--E-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEe
Q 020784 158 VMIWDDHQSRCIGELSFRS-EVRSVKLRRDRIIVV--L-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVC 233 (321)
Q Consensus 158 v~iWD~~~~~~~~~~~~~~-~v~~v~~~~~~~~~~--~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~ 233 (321)
|+|||....+.-..+..++ .|.+++||+.+-.++ + |+.|++||.++++++.++..|.+.+..+.|+++ +++|+
T Consensus 204 ikiWdf~~~kee~vL~GHgwdVksvdWHP~kgLiasgskDnlVKlWDprSg~cl~tlh~HKntVl~~~f~~n--~N~Ll- 280 (464)
T KOG0284|consen 204 IKIWDFRMPKEERVLRGHGWDVKSVDWHPTKGLIASGSKDNLVKLWDPRSGSCLATLHGHKNTVLAVKFNPN--GNWLL- 280 (464)
T ss_pred EEEEeccCCchhheeccCCCCcceeccCCccceeEEccCCceeEeecCCCcchhhhhhhccceEEEEEEcCC--CCeeE-
Confidence 9999998877655566665 799999999653333 3 359999999999999999998876655555554 48888
Q ss_pred ecCCCCcEEEEeeCC-cceEEeeccccceeEEEECCC-CCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEe--
Q 020784 234 PGLQKGQVRVEHYAS-KRTKFIMAHDSRIACFALTQD-GQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLW-- 309 (321)
Q Consensus 234 sGs~dg~V~i~d~~~-~~~~~l~~H~~~V~~vafspd-g~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s-- 309 (321)
+++.|..++++|+.+ +.+.++++|+..|++++|+|- ..+|++|+.||. |..|.+...+.+.....+|+..+-+++
T Consensus 281 t~skD~~~kv~DiR~mkEl~~~r~Hkkdv~~~~WhP~~~~lftsgg~Dgs-vvh~~v~~~~p~~~i~~AHd~~iwsl~~h 359 (464)
T KOG0284|consen 281 TGSKDQSCKVFDIRTMKELFTYRGHKKDVTSLTWHPLNESLFTSGGSDGS-VVHWVVGLEEPLGEIPPAHDGEIWSLAYH 359 (464)
T ss_pred EccCCceEEEEehhHhHHHHHhhcchhhheeeccccccccceeeccCCCc-eEEEeccccccccCCCcccccceeeeecc
Confidence 599999999999984 557899999999999999985 578999999999 999999977777778778887776655
Q ss_pred ecCceEEEe
Q 020784 310 LSSAWLRVL 318 (321)
Q Consensus 310 ~d~~~la~~ 318 (321)
+=|..||.+
T Consensus 360 PlGhil~tg 368 (464)
T KOG0284|consen 360 PLGHILATG 368 (464)
T ss_pred ccceeEeec
Confidence 444666554
No 34
>KOG0276 consensus Vesicle coat complex COPI, beta' subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.92 E-value=1.3e-23 Score=193.86 Aligned_cols=218 Identities=11% Similarity=0.136 Sum_probs=179.1
Q ss_pred CCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEe
Q 020784 84 PPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWD 162 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD 162 (321)
+..+|.||.|+|...++.++--.| |.|||.++...+...+. .+-+|+...+..+-+.+++.+ +|..|||++
T Consensus 12 rSdRVKsVd~HPtePw~la~LynG~V~IWnyetqtmVksfeV-~~~PvRa~kfiaRknWiv~Gs-------DD~~IrVfn 83 (794)
T KOG0276|consen 12 RSDRVKSVDFHPTEPWILAALYNGDVQIWNYETQTMVKSFEV-SEVPVRAAKFIARKNWIVTGS-------DDMQIRVFN 83 (794)
T ss_pred cCCceeeeecCCCCceEEEeeecCeeEEEecccceeeeeeee-cccchhhheeeeccceEEEec-------CCceEEEEe
Confidence 556999999999999988887755 88999999877666655 366788888877888777766 789999999
Q ss_pred CCCCcEEEEEeeCC-ceeEEEEeCCeEEE--EECC-EEEEEEcCC-cEEEEEEeccCCCCceEEEeeCCCceEEEeecCC
Q 020784 163 DHQSRCIGELSFRS-EVRSVKLRRDRIIV--VLEQ-KIFVYNFAD-LKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQ 237 (321)
Q Consensus 163 ~~~~~~~~~~~~~~-~v~~v~~~~~~~~~--~~~~-~I~iwd~~~-~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~ 237 (321)
.++++.+..|+-|. .|.++..||..-.+ ++|+ +|++||.++ ..+.++|++|.+.+..++|.|. |.+.+| |++-
T Consensus 84 ynt~ekV~~FeAH~DyIR~iavHPt~P~vLtsSDDm~iKlW~we~~wa~~qtfeGH~HyVMqv~fnPk-D~ntFa-S~sL 161 (794)
T KOG0276|consen 84 YNTGEKVKTFEAHSDYIRSIAVHPTLPYVLTSSDDMTIKLWDWENEWACEQTFEGHEHYVMQVAFNPK-DPNTFA-SASL 161 (794)
T ss_pred cccceeeEEeeccccceeeeeecCCCCeEEecCCccEEEEeeccCceeeeeEEcCcceEEEEEEecCC-Ccccee-eeec
Confidence 99999999998665 79999999976443 4455 999999964 6888999999988888888876 445677 6999
Q ss_pred CCcEEEEeeCCc-ceEEeeccccceeEEEECCCC--CEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCc
Q 020784 238 KGQVRVEHYASK-RTKFIMAHDSRIACFALTQDG--QLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSA 313 (321)
Q Consensus 238 dg~V~i~d~~~~-~~~~l~~H~~~V~~vafspdg--~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~ 313 (321)
|++|+||.+... +..+|.+|...|+||.|-+-| .+|+||++|.+ |||||.+|.+|+++++ ||...+....|-+.
T Consensus 162 DrTVKVWslgs~~~nfTl~gHekGVN~Vdyy~~gdkpylIsgaDD~t-iKvWDyQtk~CV~TLe-GHt~Nvs~v~fhp~ 238 (794)
T KOG0276|consen 162 DRTVKVWSLGSPHPNFTLEGHEKGVNCVDYYTGGDKPYLISGADDLT-IKVWDYQTKSCVQTLE-GHTNNVSFVFFHPE 238 (794)
T ss_pred cccEEEEEcCCCCCceeeeccccCcceEEeccCCCcceEEecCCCce-EEEeecchHHHHHHhh-cccccceEEEecCC
Confidence 999999998764 477999999999999998654 69999999999 9999999999999994 66655554444443
No 35
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=99.91 E-value=1.2e-21 Score=171.46 Aligned_cols=225 Identities=16% Similarity=0.213 Sum_probs=173.6
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
..|...+.++.|++++++|++++.++ +++|++...+....... |...+..+.+.+++..+++++ .++.|++
T Consensus 48 ~~~~~~i~~~~~~~~~~~l~~~~~~~~i~i~~~~~~~~~~~~~~-~~~~i~~~~~~~~~~~~~~~~-------~~~~i~~ 119 (289)
T cd00200 48 KGHTGPVRDVAASADGTYLASGSSDKTIRLWDLETGECVRTLTG-HTSYVSSVAFSPDGRILSSSS-------RDKTIKV 119 (289)
T ss_pred ecCCcceeEEEECCCCCEEEEEcCCCeEEEEEcCcccceEEEec-cCCcEEEEEEcCCCCEEEEec-------CCCeEEE
Confidence 45667889999999999999988654 88999988655544443 456788888887766555544 4699999
Q ss_pred EeCCCCcEEEEEe-eCCceeEEEEeCC--eEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecC
Q 020784 161 WDDHQSRCIGELS-FRSEVRSVKLRRD--RIIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGL 236 (321)
Q Consensus 161 WD~~~~~~~~~~~-~~~~v~~v~~~~~--~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs 236 (321)
||+.+++....+. +...+.++.++++ .++++. ++.|++||+++++.+..+..+...+..+.+++ ++..+++ ++
T Consensus 120 ~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~l~~~~~~~~i~i~d~~~~~~~~~~~~~~~~i~~~~~~~--~~~~l~~-~~ 196 (289)
T cd00200 120 WDVETGKCLTTLRGHTDWVNSVAFSPDGTFVASSSQDGTIKLWDLRTGKCVATLTGHTGEVNSVAFSP--DGEKLLS-SS 196 (289)
T ss_pred EECCCcEEEEEeccCCCcEEEEEEcCcCCEEEEEcCCCcEEEEEccccccceeEecCccccceEEECC--CcCEEEE-ec
Confidence 9999888777776 3457999999984 344444 67999999998888888887765555555554 4455654 56
Q ss_pred CCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCccee--EEEeecCc
Q 020784 237 QKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQ--SGLWLSSA 313 (321)
Q Consensus 237 ~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~--~~~s~d~~ 313 (321)
.+|.|++||..... +..+..|...|.+++|++++.++++++.||. |++||+.+++.+..+. ++...+ +.++.++.
T Consensus 197 ~~~~i~i~d~~~~~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~~~~-i~i~~~~~~~~~~~~~-~~~~~i~~~~~~~~~~ 274 (289)
T cd00200 197 SDGTIKLWDLSTGKCLGTLRGHENGVNSVAFSPDGYLLASGSEDGT-IRVWDLRTGECVQTLS-GHTNSVTSLAWSPDGK 274 (289)
T ss_pred CCCcEEEEECCCCceecchhhcCCceEEEEEcCCCcEEEEEcCCCc-EEEEEcCCceeEEEcc-ccCCcEEEEEECCCCC
Confidence 69999999998654 5567789999999999999999999998999 9999999999988886 554333 45666778
Q ss_pred eEEEee
Q 020784 314 WLRVLR 319 (321)
Q Consensus 314 ~la~~~ 319 (321)
+|+++.
T Consensus 275 ~l~~~~ 280 (289)
T cd00200 275 RLASGS 280 (289)
T ss_pred EEEEec
Confidence 887753
No 36
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=99.91 E-value=9.7e-23 Score=174.36 Aligned_cols=225 Identities=16% Similarity=0.228 Sum_probs=173.5
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
..|..++.+|+|.++.+.+..|.++.|+.+|+.++....... |+..+.+++.....+.+++++ -|++|++|
T Consensus 51 ~~~~~plL~c~F~d~~~~~~G~~dg~vr~~Dln~~~~~~igt--h~~~i~ci~~~~~~~~vIsgs-------WD~~ik~w 121 (323)
T KOG1036|consen 51 FKHGAPLLDCAFADESTIVTGGLDGQVRRYDLNTGNEDQIGT--HDEGIRCIEYSYEVGCVISGS-------WDKTIKFW 121 (323)
T ss_pred eecCCceeeeeccCCceEEEeccCceEEEEEecCCcceeecc--CCCceEEEEeeccCCeEEEcc-------cCccEEEE
Confidence 456779999999997765555555669999999988765555 689999999887777776666 57999999
Q ss_pred eCCCCcEEEEEeeCCceeEEEEeCCeEEEEE-CCEEEEEEcCCcEEEEEEeccC--CCCceEEEeeCCCceEEEeecCCC
Q 020784 162 DDHQSRCIGELSFRSEVRSVKLRRDRIIVVL-EQKIFVYNFADLKLLHQIETIA--NPKGLCAVSQGVGSLVLVCPGLQK 238 (321)
Q Consensus 162 D~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~-~~~I~iwd~~~~~~~~~l~~~~--~~~~~~~~s~~~d~~~la~sGs~d 238 (321)
|.+....+..+.....|+++....+.+++++ +..|.+||+++.+......... -.+.++++-++.. -.++ ++.|
T Consensus 122 D~R~~~~~~~~d~~kkVy~~~v~g~~LvVg~~~r~v~iyDLRn~~~~~q~reS~lkyqtR~v~~~pn~e--Gy~~-sSie 198 (323)
T KOG1036|consen 122 DPRNKVVVGTFDQGKKVYCMDVSGNRLVVGTSDRKVLIYDLRNLDEPFQRRESSLKYQTRCVALVPNGE--GYVV-SSIE 198 (323)
T ss_pred eccccccccccccCceEEEEeccCCEEEEeecCceEEEEEcccccchhhhccccceeEEEEEEEecCCC--ceEE-Eeec
Confidence 9998777777777779999999999999965 5699999999876544222211 1233455555443 3442 8999
Q ss_pred CcEEEEeeCCc-----ceEEeecccc---------ceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCC-Ccc
Q 020784 239 GQVRVEHYASK-----RTKFIMAHDS---------RIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCP-SIS 303 (321)
Q Consensus 239 g~V~i~d~~~~-----~~~~l~~H~~---------~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g-~~~ 303 (321)
|.|.+..+... .-..|+.|.. +|++|+|+|-...||||+.||. |.+||+.+.|.+.++..- ...
T Consensus 199 GRVavE~~d~s~~~~skkyaFkCHr~~~~~~~~~yPVNai~Fhp~~~tfaTgGsDG~-V~~Wd~~~rKrl~q~~~~~~SI 277 (323)
T KOG1036|consen 199 GRVAVEYFDDSEEAQSKKYAFKCHRLSEKDTEIIYPVNAIAFHPIHGTFATGGSDGI-VNIWDLFNRKRLKQLAKYETSI 277 (323)
T ss_pred ceEEEEccCCchHHhhhceeEEeeecccCCceEEEEeceeEeccccceEEecCCCce-EEEccCcchhhhhhccCCCCce
Confidence 99999544433 2347888853 6999999999999999999999 999999999999888554 445
Q ss_pred eeEEEeecCceEEEee
Q 020784 304 AQSGLWLSSAWLRVLR 319 (321)
Q Consensus 304 ~~~~~s~d~~~la~~~ 319 (321)
..++|+.||..||+|.
T Consensus 278 ~slsfs~dG~~LAia~ 293 (323)
T KOG1036|consen 278 SSLSFSMDGSLLAIAS 293 (323)
T ss_pred EEEEeccCCCeEEEEe
Confidence 6679999999999985
No 37
>KOG0643 consensus Translation initiation factor 3, subunit i (eIF-3i)/TGF-beta receptor-interacting protein (TRIP-1) [Translation, ribosomal structure and biogenesis; Signal transduction mechanisms]
Probab=99.91 E-value=4.5e-22 Score=167.31 Aligned_cols=218 Identities=11% Similarity=0.121 Sum_probs=178.7
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
..+|+.+++-|.++.+|.+|.+++.|. .-||-...++.+-.+.. |.+.|-++++..++..+++.+ .|++++
T Consensus 6 l~GHERplTqiKyN~eGDLlFscaKD~~~~vw~s~nGerlGty~G-HtGavW~~Did~~s~~liTGS-------AD~t~k 77 (327)
T KOG0643|consen 6 LQGHERPLTQIKYNREGDLLFSCAKDSTPTVWYSLNGERLGTYDG-HTGAVWCCDIDWDSKHLITGS-------ADQTAK 77 (327)
T ss_pred cccCccccceEEecCCCcEEEEecCCCCceEEEecCCceeeeecC-CCceEEEEEecCCcceeeecc-------ccceeE
Confidence 357889999999999999999988865 55999888888877776 789999999999998888777 689999
Q ss_pred EEeCCCCcEEEEEeeCCceeEEEEeCC--eEEEEEC------CEEEEEEcC-------CcEEEEEEeccCCCCceEEEee
Q 020784 160 IWDDHQSRCIGELSFRSEVRSVKLRRD--RIIVVLE------QKIFVYNFA-------DLKLLHQIETIANPKGLCAVSQ 224 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~~~v~~v~~~~~--~~~~~~~------~~I~iwd~~-------~~~~~~~l~~~~~~~~~~~~s~ 224 (321)
+||+.+|+++..++....|..+.|+.. .++++++ +.|.++|++ ..+++.++..+........+.+
T Consensus 78 LWDv~tGk~la~~k~~~~Vk~~~F~~~gn~~l~~tD~~mg~~~~v~~fdi~~~~~~~~s~ep~~kI~t~~skit~a~Wg~ 157 (327)
T KOG0643|consen 78 LWDVETGKQLATWKTNSPVKRVDFSFGGNLILASTDKQMGYTCFVSVFDIRDDSSDIDSEEPYLKIPTPDSKITSALWGP 157 (327)
T ss_pred EEEcCCCcEEEEeecCCeeEEEeeccCCcEEEEEehhhcCcceEEEEEEccCChhhhcccCceEEecCCccceeeeeecc
Confidence 999999999999999999999999864 4445554 489999997 4556777777765554555554
Q ss_pred CCCceEEEeecCCCCcEEEEeeCCcce--EEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCc
Q 020784 225 GVGSLVLVCPGLQKGQVRVEHYASKRT--KFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSI 302 (321)
Q Consensus 225 ~~d~~~la~sGs~dg~V~i~d~~~~~~--~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~ 302 (321)
- +..|+ +|..||.|.+||..++.. ..-+.|...|+.+.|++|..+|+|+|.|.+ -++||+.+.+++++|.....
T Consensus 158 l--~~~ii-~Ghe~G~is~~da~~g~~~v~s~~~h~~~Ind~q~s~d~T~FiT~s~Dtt-akl~D~~tl~v~Kty~te~P 233 (327)
T KOG0643|consen 158 L--GETII-AGHEDGSISIYDARTGKELVDSDEEHSSKINDLQFSRDRTYFITGSKDTT-AKLVDVRTLEVLKTYTTERP 233 (327)
T ss_pred c--CCEEE-EecCCCcEEEEEcccCceeeechhhhccccccccccCCcceEEecccCcc-ceeeeccceeeEEEeeeccc
Confidence 3 46666 499999999999987643 355779999999999999999999999999 99999999999999976554
Q ss_pred ceeEEEee
Q 020784 303 SAQSGLWL 310 (321)
Q Consensus 303 ~~~~~~s~ 310 (321)
....++++
T Consensus 234 vN~aaisP 241 (327)
T KOG0643|consen 234 VNTAAISP 241 (327)
T ss_pred ccceeccc
Confidence 43445554
No 38
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=99.91 E-value=2.2e-22 Score=175.47 Aligned_cols=227 Identities=16% Similarity=0.158 Sum_probs=174.0
Q ss_pred ccCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcE
Q 020784 80 TSSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 80 ~~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
.-..|+..|+|+.||-||.+||+|+-+| |+||...++........ ....+..+.|++....++..+ .||.|
T Consensus 101 eltgHKDSVt~~~FshdgtlLATGdmsG~v~v~~~stg~~~~~~~~-e~~dieWl~WHp~a~illAG~-------~DGsv 172 (399)
T KOG0296|consen 101 ELTGHKDSVTCCSFSHDGTLLATGDMSGKVLVFKVSTGGEQWKLDQ-EVEDIEWLKWHPRAHILLAGS-------TDGSV 172 (399)
T ss_pred EecCCCCceEEEEEccCceEEEecCCCccEEEEEcccCceEEEeec-ccCceEEEEecccccEEEeec-------CCCcE
Confidence 3467899999999999999999999866 78999999887665532 256788889998777776655 68999
Q ss_pred EEEeCCCCcEEEEEeeCC-ceeEEEEeCCe--EEEE-ECCEEEEEEcCCcEEEEEEeccCCC---------Cc-------
Q 020784 159 MIWDDHQSRCIGELSFRS-EVRSVKLRRDR--IIVV-LEQKIFVYNFADLKLLHQIETIANP---------KG------- 218 (321)
Q Consensus 159 ~iWD~~~~~~~~~~~~~~-~v~~v~~~~~~--~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~---------~~------- 218 (321)
-.|.+.++...+.+..+. ++.+-+|.++. ++.+ .+++|++||..+++.++++....+. ..
T Consensus 173 Wmw~ip~~~~~kv~~Gh~~~ct~G~f~pdGKr~~tgy~dgti~~Wn~ktg~p~~~~~~~e~~~~~~~~~~~~~~~~~~g~ 252 (399)
T KOG0296|consen 173 WMWQIPSQALCKVMSGHNSPCTCGEFIPDGKRILTGYDDGTIIVWNPKTGQPLHKITQAEGLELPCISLNLAGSTLTKGN 252 (399)
T ss_pred EEEECCCcceeeEecCCCCCcccccccCCCceEEEEecCceEEEEecCCCceeEEecccccCcCCccccccccceeEecc
Confidence 999999876666666654 67787887753 4444 3579999999999998887621100 00
Q ss_pred -------------eEEEeeC-----------------------CCceEEEeecCCCCcEEEEeeCCcceEEeecccccee
Q 020784 219 -------------LCAVSQG-----------------------VGSLVLVCPGLQKGQVRVEHYASKRTKFIMAHDSRIA 262 (321)
Q Consensus 219 -------------~~~~s~~-----------------------~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~H~~~V~ 262 (321)
.+..+.+ ..-.+.| .|+.||+|.|||+....+...-.|...|.
T Consensus 253 ~e~~~~~~~~~sgKVv~~~n~~~~~l~~~~e~~~esve~~~~ss~lpL~A-~G~vdG~i~iyD~a~~~~R~~c~he~~V~ 331 (399)
T KOG0296|consen 253 SEGVACGVNNGSGKVVNCNNGTVPELKPSQEELDESVESIPSSSKLPLAA-CGSVDGTIAIYDLAASTLRHICEHEDGVT 331 (399)
T ss_pred CCccEEEEccccceEEEecCCCCccccccchhhhhhhhhcccccccchhh-cccccceEEEEecccchhheeccCCCceE
Confidence 0011111 1112334 48889999999999888888888999999
Q ss_pred EEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeE--EEeecCceEEEe
Q 020784 263 CFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQS--GLWLSSAWLRVL 318 (321)
Q Consensus 263 ~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~--~~s~d~~~la~~ 318 (321)
.+.|-+ ..+|++++.||+ ||+||.++|+++.+| +||...++ +++++.+++..+
T Consensus 332 ~l~w~~-t~~l~t~c~~g~-v~~wDaRtG~l~~~y-~GH~~~Il~f~ls~~~~~vvT~ 386 (399)
T KOG0296|consen 332 KLKWLN-TDYLLTACANGK-VRQWDARTGQLKFTY-TGHQMGILDFALSPQKRLVVTV 386 (399)
T ss_pred EEEEcC-cchheeeccCce-EEeeeccccceEEEE-ecCchheeEEEEcCCCcEEEEe
Confidence 999998 778889999999 999999999999999 68998777 556777777654
No 39
>KOG0282 consensus mRNA splicing factor [Function unknown]
Probab=99.91 E-value=4.2e-24 Score=192.00 Aligned_cols=226 Identities=12% Similarity=0.101 Sum_probs=176.5
Q ss_pred cCCCCCCeEEEEEcC-CCCEEEEEcCCc-EEEEEecC-CceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCc
Q 020784 81 SSSPPPTLLHISFNQ-DHGCFAAGTDHG-FRIYNCDP-FREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNK 157 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~-dg~~lasg~~~g-v~vw~~~~-~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~ 157 (321)
.++|+..|+++.|.| .+.+|++|+.|+ |.||++-. .+++..... |..+|..+.++.++..+.+++ .|+.
T Consensus 210 ~~gH~kgvsai~~fp~~~hLlLS~gmD~~vklW~vy~~~~~lrtf~g-H~k~Vrd~~~s~~g~~fLS~s-------fD~~ 281 (503)
T KOG0282|consen 210 LSGHTKGVSAIQWFPKKGHLLLSGGMDGLVKLWNVYDDRRCLRTFKG-HRKPVRDASFNNCGTSFLSAS-------FDRF 281 (503)
T ss_pred ccCCccccchhhhccceeeEEEecCCCceEEEEEEecCcceehhhhc-chhhhhhhhccccCCeeeeee-------ccee
Confidence 368889999999999 889999998876 78999866 455444443 788899999999998888888 7899
Q ss_pred EEEEeCCCCcEEEEEeeCCceeEEEEeCCe---EEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEe
Q 020784 158 VMIWDDHQSRCIGELSFRSEVRSVKLRRDR---IIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVC 233 (321)
Q Consensus 158 v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~---~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~ 233 (321)
||+||+++|+++..+.....++++.|+++. ++++ .++.|+.||+++++.++.+..|.+.+..+.|-. ++..++
T Consensus 282 lKlwDtETG~~~~~f~~~~~~~cvkf~pd~~n~fl~G~sd~ki~~wDiRs~kvvqeYd~hLg~i~~i~F~~--~g~rFi- 358 (503)
T KOG0282|consen 282 LKLWDTETGQVLSRFHLDKVPTCVKFHPDNQNIFLVGGSDKKIRQWDIRSGKVVQEYDRHLGAILDITFVD--EGRRFI- 358 (503)
T ss_pred eeeeccccceEEEEEecCCCceeeecCCCCCcEEEEecCCCcEEEEeccchHHHHHHHhhhhheeeeEEcc--CCceEe-
Confidence 999999999999999999999999999863 4444 457999999999999999988877665555544 456666
Q ss_pred ecCCCCcEEEEeeCCc-----------------------------------------------ceEEeeccc--cceeEE
Q 020784 234 PGLQKGQVRVEHYASK-----------------------------------------------RTKFIMAHD--SRIACF 264 (321)
Q Consensus 234 sGs~dg~V~i~d~~~~-----------------------------------------------~~~~l~~H~--~~V~~v 264 (321)
+.+.|+.++||++... ..+.|.+|. +.-..|
T Consensus 359 ssSDdks~riWe~~~~v~ik~i~~~~~hsmP~~~~~P~~~~~~aQs~dN~i~ifs~~~~~r~nkkK~feGh~vaGys~~v 438 (503)
T KOG0282|consen 359 SSSDDKSVRIWENRIPVPIKNIADPEMHTMPCLTLHPNGKWFAAQSMDNYIAIFSTVPPFRLNKKKRFEGHSVAGYSCQV 438 (503)
T ss_pred eeccCccEEEEEcCCCccchhhcchhhccCcceecCCCCCeehhhccCceEEEEecccccccCHhhhhcceeccCceeeE
Confidence 5789999999985321 112355664 345778
Q ss_pred EECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecC---ceEEEee
Q 020784 265 ALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSS---AWLRVLR 319 (321)
Q Consensus 265 afspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~---~~la~~~ 319 (321)
.|||||.+|++|+.||. +.+||.++-+++.+++.. +...+...+-+ +.+|.|.
T Consensus 439 ~fSpDG~~l~SGdsdG~-v~~wdwkt~kl~~~lkah-~~~ci~v~wHP~e~Skvat~~ 494 (503)
T KOG0282|consen 439 DFSPDGRTLCSGDSDGK-VNFWDWKTTKLVSKLKAH-DQPCIGVDWHPVEPSKVATCG 494 (503)
T ss_pred EEcCCCCeEEeecCCcc-EEEeechhhhhhhccccC-CcceEEEEecCCCcceeEecc
Confidence 99999999999999999 999999999999999654 44444333322 5555553
No 40
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=99.91 E-value=2.4e-23 Score=182.51 Aligned_cols=193 Identities=14% Similarity=0.163 Sum_probs=154.7
Q ss_pred CCCCCCeEEEEEcC-----CCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCC
Q 020784 82 SSPPPTLLHISFNQ-----DHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPL 155 (321)
Q Consensus 82 ~~~~~~V~~v~fs~-----dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d 155 (321)
+.|.--|++++|.| ..++||+++.|| ++|||+..+.+++.... |...|.|+.|-.. .++...+ .|
T Consensus 197 ~gH~K~It~Lawep~hl~p~~r~las~skDg~vrIWd~~~~~~~~~lsg-HT~~VTCvrwGG~-gliySgS-------~D 267 (480)
T KOG0271|consen 197 RGHKKWITALAWEPLHLVPPCRRLASSSKDGSVRIWDTKLGTCVRTLSG-HTASVTCVRWGGE-GLIYSGS-------QD 267 (480)
T ss_pred cCcccceeEEeecccccCCCccceecccCCCCEEEEEccCceEEEEecc-CccceEEEEEcCC-ceEEecC-------CC
Confidence 57888999999976 678999999866 99999999888777765 6778888876432 3444444 68
Q ss_pred CcEEEEeCCCCcEEEEEeeC------------------------------------------------------------
Q 020784 156 NKVMIWDDHQSRCIGELSFR------------------------------------------------------------ 175 (321)
Q Consensus 156 ~~v~iWD~~~~~~~~~~~~~------------------------------------------------------------ 175 (321)
++||+|+...|.+..+++.+
T Consensus 268 rtIkvw~a~dG~~~r~lkGHahwvN~lalsTdy~LRtgaf~~t~~~~~~~se~~~~Al~rY~~~~~~~~erlVSgsDd~t 347 (480)
T KOG0271|consen 268 RTIKVWRALDGKLCRELKGHAHWVNHLALSTDYVLRTGAFDHTGRKPKSFSEEQKKALERYEAVLKDSGERLVSGSDDFT 347 (480)
T ss_pred ceEEEEEccchhHHHhhcccchheeeeeccchhhhhccccccccccCCChHHHHHHHHHHHHHhhccCcceeEEecCCce
Confidence 99999987665443332211
Q ss_pred --------------------CceeEEEEeCCeEEEEE---CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEE
Q 020784 176 --------------------SEVRSVKLRRDRIIVVL---EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLV 232 (321)
Q Consensus 176 --------------------~~v~~v~~~~~~~~~~~---~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la 232 (321)
..|..+.|+|+..++++ |+.||+||.++|+.+.+|.+|...+..++++.+. .+|+
T Consensus 348 lflW~p~~~kkpi~rmtgHq~lVn~V~fSPd~r~IASaSFDkSVkLW~g~tGk~lasfRGHv~~VYqvawsaDs--RLlV 425 (480)
T KOG0271|consen 348 LFLWNPFKSKKPITRMTGHQALVNHVSFSPDGRYIASASFDKSVKLWDGRTGKFLASFRGHVAAVYQVAWSADS--RLLV 425 (480)
T ss_pred EEEecccccccchhhhhchhhheeeEEECCCccEEEEeecccceeeeeCCCcchhhhhhhccceeEEEEeccCc--cEEE
Confidence 12455666666655553 6799999999999999999999998888888754 7777
Q ss_pred eecCCCCcEEEEeeCCcceE-EeeccccceeEEEECCCCCEEEEEeCCCcEEEEEE
Q 020784 233 CPGLQKGQVRVEHYASKRTK-FIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 233 ~sGs~dg~V~i~d~~~~~~~-~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd 287 (321)
||+.|.++++|+.+++.+. -|.+|..+|.++.|+|||..+|+|+.|+- +|+|.
T Consensus 426 -S~SkDsTLKvw~V~tkKl~~DLpGh~DEVf~vDwspDG~rV~sggkdkv-~~lw~ 479 (480)
T KOG0271|consen 426 -SGSKDSTLKVWDVRTKKLKQDLPGHADEVFAVDWSPDGQRVASGGKDKV-LRLWR 479 (480)
T ss_pred -EcCCCceEEEEEeeeeeecccCCCCCceEEEEEecCCCceeecCCCceE-EEeec
Confidence 7999999999999998865 79999999999999999999999999998 99994
No 41
>PLN00181 protein SPA1-RELATED; Provisional
Probab=99.91 E-value=8.7e-22 Score=199.69 Aligned_cols=221 Identities=14% Similarity=0.124 Sum_probs=169.4
Q ss_pred CCCeEEEEEcC-CCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEec-CCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 85 PPTLLHISFNQ-DHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLF-RCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 85 ~~~V~~v~fs~-dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~-~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
...|.+++|++ ++.+||+|+.++ |+|||+.+.+.+..... |.+.|..+++++ +++.+++++ .|++|++|
T Consensus 532 ~~~v~~l~~~~~~~~~las~~~Dg~v~lWd~~~~~~~~~~~~-H~~~V~~l~~~p~~~~~L~Sgs-------~Dg~v~iW 603 (793)
T PLN00181 532 RSKLSGICWNSYIKSQVASSNFEGVVQVWDVARSQLVTEMKE-HEKRVWSIDYSSADPTLLASGS-------DDGSVKLW 603 (793)
T ss_pred cCceeeEEeccCCCCEEEEEeCCCeEEEEECCCCeEEEEecC-CCCCEEEEEEcCCCCCEEEEEc-------CCCEEEEE
Confidence 45799999987 478899988765 78999998876655544 678899999986 567777776 67999999
Q ss_pred eCCCCcEEEEEeeCCceeEEEEeC---CeEEEEE-CCEEEEEEcCCcE-EEEEEeccCCCCceEEEeeCCCceEEEeecC
Q 020784 162 DDHQSRCIGELSFRSEVRSVKLRR---DRIIVVL-EQKIFVYNFADLK-LLHQIETIANPKGLCAVSQGVGSLVLVCPGL 236 (321)
Q Consensus 162 D~~~~~~~~~~~~~~~v~~v~~~~---~~~~~~~-~~~I~iwd~~~~~-~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs 236 (321)
|++++..+..+..+..|.++.|++ ..+++++ ++.|++||+++.+ .+..+.+|...+..+.+. ++..++ +|+
T Consensus 604 d~~~~~~~~~~~~~~~v~~v~~~~~~g~~latgs~dg~I~iwD~~~~~~~~~~~~~h~~~V~~v~f~---~~~~lv-s~s 679 (793)
T PLN00181 604 SINQGVSIGTIKTKANICCVQFPSESGRSLAFGSADHKVYYYDLRNPKLPLCTMIGHSKTVSYVRFV---DSSTLV-SSS 679 (793)
T ss_pred ECCCCcEEEEEecCCCeEEEEEeCCCCCEEEEEeCCCeEEEEECCCCCccceEecCCCCCEEEEEEe---CCCEEE-EEE
Confidence 999999888888777899999853 3455554 5799999998765 456777776666556654 235666 589
Q ss_pred CCCcEEEEeeCC-------cceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeC----------
Q 020784 237 QKGQVRVEHYAS-------KRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECC---------- 299 (321)
Q Consensus 237 ~dg~V~i~d~~~-------~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~---------- 299 (321)
.||.|++||+.. ..+.++.+|...+++++|++++.+||+|+.|++ |+||+......+..+..
T Consensus 680 ~D~~ikiWd~~~~~~~~~~~~l~~~~gh~~~i~~v~~s~~~~~lasgs~D~~-v~iw~~~~~~~~~s~~~~~~~~~~~~~ 758 (793)
T PLN00181 680 TDNTLKLWDLSMSISGINETPLHSFMGHTNVKNFVGLSVSDGYIATGSETNE-VFVYHKAFPMPVLSYKFKTIDPVSGLE 758 (793)
T ss_pred CCCEEEEEeCCCCccccCCcceEEEcCCCCCeeEEEEcCCCCEEEEEeCCCE-EEEEECCCCCceEEEecccCCcccccc
Confidence 999999999863 346789999999999999999999999999999 99999887765543321
Q ss_pred --CCcceeE--EEeecCceEEEe
Q 020784 300 --PSISAQS--GLWLSSAWLRVL 318 (321)
Q Consensus 300 --g~~~~~~--~~s~d~~~la~~ 318 (321)
.+...+. +++.++.+|+++
T Consensus 759 ~~~~~~~V~~v~ws~~~~~lva~ 781 (793)
T PLN00181 759 VDDASQFISSVCWRGQSSTLVAA 781 (793)
T ss_pred cCCCCcEEEEEEEcCCCCeEEEe
Confidence 1122233 556677787765
No 42
>KOG2096 consensus WD40 repeat protein [General function prediction only]
Probab=99.91 E-value=7.4e-23 Score=175.81 Aligned_cols=228 Identities=19% Similarity=0.204 Sum_probs=158.7
Q ss_pred ccCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeee---cCCceEEEEEecCCCeEEEEeCCCCCCCCC
Q 020784 80 TSSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFE---RGGGIGVVEMLFRCNILALVGGGPDPQYPL 155 (321)
Q Consensus 80 ~~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~---~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d 155 (321)
...+|...|++++|+.||++||+.++|+ ||||+++.+...-++.++ .-+.-..|.+.+++..+++.... .
T Consensus 81 ~LKgH~~~vt~~~FsSdGK~lat~~~Dr~Ir~w~~~DF~~~eHr~~R~nve~dhpT~V~FapDc~s~vv~~~~------g 154 (420)
T KOG2096|consen 81 VLKGHKKEVTDVAFSSDGKKLATISGDRSIRLWDVRDFENKEHRCIRQNVEYDHPTRVVFAPDCKSVVVSVKR------G 154 (420)
T ss_pred hhhccCCceeeeEEcCCCceeEEEeCCceEEEEecchhhhhhhhHhhccccCCCceEEEECCCcceEEEEEcc------C
Confidence 3467888999999999999999988755 889999776432222221 12355677888888877766532 3
Q ss_pred CcEEEEeCCCCc---EEEE------EeeC----CceeEEEEeC--CeEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCce
Q 020784 156 NKVMIWDDHQSR---CIGE------LSFR----SEVRSVKLRR--DRIIVVL-EQKIFVYNFADLKLLHQIETIANPKGL 219 (321)
Q Consensus 156 ~~v~iWD~~~~~---~~~~------~~~~----~~v~~v~~~~--~~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~ 219 (321)
+++++|.+.+.+ .-.. +.++ ..+.++-.-. ..+..++ +.+|.+|++. |+.++++.+......-
T Consensus 155 ~~l~vyk~~K~~dG~~~~~~v~~D~~~f~~kh~v~~i~iGiA~~~k~imsas~dt~i~lw~lk-Gq~L~~idtnq~~n~~ 233 (420)
T KOG2096|consen 155 NKLCVYKLVKKTDGSGSHHFVHIDNLEFERKHQVDIINIGIAGNAKYIMSASLDTKICLWDLK-GQLLQSIDTNQSSNYD 233 (420)
T ss_pred CEEEEEEeeecccCCCCcccccccccccchhcccceEEEeecCCceEEEEecCCCcEEEEecC-Cceeeeeccccccccc
Confidence 678888764322 1110 1111 1233333333 3344444 4699999999 8888998876555566
Q ss_pred EEEeeCCCceEEEeecCCCCcEEEEeeCC---------cceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 220 CAVSQGVGSLVLVCPGLQKGQVRVEHYAS---------KRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 220 ~~~s~~~d~~~la~sGs~dg~V~i~d~~~---------~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
++++|++ .++|++|.. -.|++|..-. .....|++|.+.|...|||++.+.++|.|.||+ +||||+.=
T Consensus 234 aavSP~G--RFia~~gFT-pDVkVwE~~f~kdG~fqev~rvf~LkGH~saV~~~aFsn~S~r~vtvSkDG~-wriwdtdV 309 (420)
T KOG2096|consen 234 AAVSPDG--RFIAVSGFT-PDVKVWEPIFTKDGTFQEVKRVFSLKGHQSAVLAAAFSNSSTRAVTVSKDGK-WRIWDTDV 309 (420)
T ss_pred eeeCCCC--cEEEEecCC-CCceEEEEEeccCcchhhhhhhheeccchhheeeeeeCCCcceeEEEecCCc-EEEeeccc
Confidence 7787754 889875554 4788887531 134579999999999999999999999999999 99999762
Q ss_pred ----C---cEEEEE-----eCCCcceeEEEeecCceEEEe
Q 020784 291 ----G---TLLQEE-----CCPSISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 291 ----g---~~i~~~-----~~g~~~~~~~~s~d~~~la~~ 318 (321)
+ +.+++. ..|....++.++++|+-||++
T Consensus 310 rY~~~qDpk~Lk~g~~pl~aag~~p~RL~lsP~g~~lA~s 349 (420)
T KOG2096|consen 310 RYEAGQDPKILKEGSAPLHAAGSEPVRLELSPSGDSLAVS 349 (420)
T ss_pred eEecCCCchHhhcCCcchhhcCCCceEEEeCCCCcEEEee
Confidence 2 222222 235566788999999999986
No 43
>KOG0318 consensus WD40 repeat stress protein/actin interacting protein [Cytoskeleton]
Probab=99.91 E-value=9.3e-22 Score=178.57 Aligned_cols=216 Identities=17% Similarity=0.265 Sum_probs=176.2
Q ss_pred CcccCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeee-cCCceEEEEEecCCCeEEEEeCCCCCCCCC
Q 020784 78 ESTSSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFE-RGGGIGVVEMLFRCNILALVGGGPDPQYPL 155 (321)
Q Consensus 78 ~~~~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~-~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d 155 (321)
..+...|..+|+-..|+|.|-|+|+|...| |||||+...+.+.+.+++ -.++|..+.|.+++..++.++.|++ .=
T Consensus 52 ~~iYtEH~~~vtVAkySPsG~yiASGD~sG~vRIWdtt~~~hiLKnef~v~aG~I~Di~Wd~ds~RI~avGEGre---rf 128 (603)
T KOG0318|consen 52 VDIYTEHAHQVTVAKYSPSGFYIASGDVSGKVRIWDTTQKEHILKNEFQVLAGPIKDISWDFDSKRIAAVGEGRE---RF 128 (603)
T ss_pred eeeeccccceeEEEEeCCCceEEeecCCcCcEEEEeccCcceeeeeeeeecccccccceeCCCCcEEEEEecCcc---ce
Confidence 344566777999999999999999999854 999998776666565553 2588999999999999999998865 22
Q ss_pred CcEEEEeCCCCcEEEEEeeCC-ceeEEEEeCC---eEEEEEC-CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceE
Q 020784 156 NKVMIWDDHQSRCIGELSFRS-EVRSVKLRRD---RIIVVLE-QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLV 230 (321)
Q Consensus 156 ~~v~iWD~~~~~~~~~~~~~~-~v~~v~~~~~---~~~~~~~-~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~ 230 (321)
+.+.+|| +|..+.++..++ .|.++.|.+. +++.+++ +.|-+|+-.-.+...++..|..-+.++.++|+ +..
T Consensus 129 g~~F~~D--SG~SvGei~GhSr~ins~~~KpsRPfRi~T~sdDn~v~ffeGPPFKFk~s~r~HskFV~~VRysPD--G~~ 204 (603)
T KOG0318|consen 129 GHVFLWD--SGNSVGEITGHSRRINSVDFKPSRPFRIATGSDDNTVAFFEGPPFKFKSSFREHSKFVNCVRYSPD--GSR 204 (603)
T ss_pred eEEEEec--CCCccceeeccceeEeeeeccCCCceEEEeccCCCeEEEeeCCCeeeeecccccccceeeEEECCC--CCe
Confidence 6677777 556667777765 6888888764 4556655 59999999888888888888887777777765 577
Q ss_pred EEeecCCCCcEEEEeeCCcc-eEEee---ccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCc
Q 020784 231 LVCPGLQKGQVRVEHYASKR-TKFIM---AHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSI 302 (321)
Q Consensus 231 la~sGs~dg~V~i~d~~~~~-~~~l~---~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~ 302 (321)
+| +.+.||+|.++|-.++. +..|. +|++.|.+|+|+||+..|+|+|.|.+ +||||+.+.++++++..+..
T Consensus 205 Fa-t~gsDgki~iyDGktge~vg~l~~~~aHkGsIfalsWsPDs~~~~T~SaDkt-~KIWdVs~~slv~t~~~~~~ 278 (603)
T KOG0318|consen 205 FA-TAGSDGKIYIYDGKTGEKVGELEDSDAHKGSIFALSWSPDSTQFLTVSADKT-IKIWDVSTNSLVSTWPMGST 278 (603)
T ss_pred EE-EecCCccEEEEcCCCccEEEEecCCCCccccEEEEEECCCCceEEEecCCce-EEEEEeeccceEEEeecCCc
Confidence 87 47889999999977765 55776 89999999999999999999999999 99999999999999987766
No 44
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.91 E-value=2.6e-22 Score=180.74 Aligned_cols=219 Identities=16% Similarity=0.232 Sum_probs=166.5
Q ss_pred CCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC
Q 020784 86 PTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH 164 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~ 164 (321)
..|.+++|-.||++||+|++-| |+|||+.+...+..... |..++..+.+++..+.+++.++ +|+.+++||+.
T Consensus 69 ~~v~s~~fR~DG~LlaaGD~sG~V~vfD~k~r~iLR~~~a-h~apv~~~~f~~~d~t~l~s~s------Dd~v~k~~d~s 141 (487)
T KOG0310|consen 69 DVVYSVDFRSDGRLLAAGDESGHVKVFDMKSRVILRQLYA-HQAPVHVTKFSPQDNTMLVSGS------DDKVVKYWDLS 141 (487)
T ss_pred cceeEEEeecCCeEEEccCCcCcEEEeccccHHHHHHHhh-ccCceeEEEecccCCeEEEecC------CCceEEEEEcC
Confidence 4799999999999999999966 78999666333322222 6889999999988877765553 47999999999
Q ss_pred CCcEEEEEeeCC-ceeEEEEeCC--eEEEEE--CCEEEEEEcCCc-EEEEEEeccCCCCceEEEeeCCCceEEEeecCCC
Q 020784 165 QSRCIGELSFRS-EVRSVKLRRD--RIIVVL--EQKIFVYNFADL-KLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQK 238 (321)
Q Consensus 165 ~~~~~~~~~~~~-~v~~v~~~~~--~~~~~~--~~~I~iwd~~~~-~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~d 238 (321)
+.....++..+. .|.+.+|++- .+++.+ |++||+||++.. ..+.++.. ..++..+.+-+. +.++|..|+
T Consensus 142 ~a~v~~~l~~htDYVR~g~~~~~~~hivvtGsYDg~vrl~DtR~~~~~v~elnh-g~pVe~vl~lps--gs~iasAgG-- 216 (487)
T KOG0310|consen 142 TAYVQAELSGHTDYVRCGDISPANDHIVVTGSYDGKVRLWDTRSLTSRVVELNH-GCPVESVLALPS--GSLIASAGG-- 216 (487)
T ss_pred CcEEEEEecCCcceeEeeccccCCCeEEEecCCCceEEEEEeccCCceeEEecC-CCceeeEEEcCC--CCEEEEcCC--
Confidence 888755666554 7999999863 444443 689999999876 55666654 345544444443 367774333
Q ss_pred CcEEEEeeCCc-ceEE-eeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEE
Q 020784 239 GQVRVEHYASK-RTKF-IMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLR 316 (321)
Q Consensus 239 g~V~i~d~~~~-~~~~-l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la 316 (321)
..|+|||+.++ ++.. +..|...|+|+++..++..|.|||-||. |||||+.+.+.++.++.....-.++++++++-++
T Consensus 217 n~vkVWDl~~G~qll~~~~~H~KtVTcL~l~s~~~rLlS~sLD~~-VKVfd~t~~Kvv~s~~~~~pvLsiavs~dd~t~v 295 (487)
T KOG0310|consen 217 NSVKVWDLTTGGQLLTSMFNHNKTVTCLRLASDSTRLLSGSLDRH-VKVFDTTNYKVVHSWKYPGPVLSIAVSPDDQTVV 295 (487)
T ss_pred CeEEEEEecCCceehhhhhcccceEEEEEeecCCceEeecccccc-eEEEEccceEEEEeeecccceeeEEecCCCceEE
Confidence 48999999854 4443 4449999999999999999999999999 9999999999999998777666678889888776
Q ss_pred E
Q 020784 317 V 317 (321)
Q Consensus 317 ~ 317 (321)
+
T Consensus 296 i 296 (487)
T KOG0310|consen 296 I 296 (487)
T ss_pred E
Confidence 5
No 45
>KOG0647 consensus mRNA export protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.91 E-value=3e-22 Score=170.92 Aligned_cols=228 Identities=15% Similarity=0.151 Sum_probs=176.7
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
...|.++|.+++|+.||..+++|+. +.+++||+.+++...... |+++|..+.|....++-.++.|+ -|++||
T Consensus 68 ~~~~~~PvL~v~WsddgskVf~g~~Dk~~k~wDL~S~Q~~~v~~--Hd~pvkt~~wv~~~~~~cl~TGS-----WDKTlK 140 (347)
T KOG0647|consen 68 QQSHDGPVLDVCWSDDGSKVFSGGCDKQAKLWDLASGQVSQVAA--HDAPVKTCHWVPGMNYQCLVTGS-----WDKTLK 140 (347)
T ss_pred hhccCCCeEEEEEccCCceEEeeccCCceEEEEccCCCeeeeee--cccceeEEEEecCCCcceeEecc-----ccccee
Confidence 3567889999999999999888876 558999999986543333 79999999998877755556655 579999
Q ss_pred EEeCCCCcEEEEEeeCCceeEEEEeCCeEEEEEC-CEEEEEEcCCcEEE-EEEeccC-CCCceEEEeeCCCceEEEeecC
Q 020784 160 IWDDHQSRCIGELSFRSEVRSVKLRRDRIIVVLE-QKIFVYNFADLKLL-HQIETIA-NPKGLCAVSQGVGSLVLVCPGL 236 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~-~~I~iwd~~~~~~~-~~l~~~~-~~~~~~~~s~~~d~~~la~sGs 236 (321)
.||++....+.++++...++++......+++++. ..|.+|+++++... +.++... ..+.++++..+.++. |+ |+
T Consensus 141 fWD~R~~~pv~t~~LPeRvYa~Dv~~pm~vVata~r~i~vynL~n~~te~k~~~SpLk~Q~R~va~f~d~~~~--al-Gs 217 (347)
T KOG0647|consen 141 FWDTRSSNPVATLQLPERVYAADVLYPMAVVATAERHIAVYNLENPPTEFKRIESPLKWQTRCVACFQDKDGF--AL-GS 217 (347)
T ss_pred ecccCCCCeeeeeeccceeeehhccCceeEEEecCCcEEEEEcCCCcchhhhhcCcccceeeEEEEEecCCce--Ee-ee
Confidence 9999999999999999999999998888888875 59999999765332 2222221 124566666666554 43 89
Q ss_pred CCCcEEEEeeCC---cceEEeecccc---------ceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCc-c
Q 020784 237 QKGQVRVEHYAS---KRTKFIMAHDS---------RIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSI-S 303 (321)
Q Consensus 237 ~dg~V~i~d~~~---~~~~~l~~H~~---------~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~-~ 303 (321)
.+|.|.|-.+.. +.-.+|+.|.. .|++|+|+|....|||++.||+ +..||-.....+++...-.. .
T Consensus 218 iEGrv~iq~id~~~~~~nFtFkCHR~~~~~~~~VYaVNsi~FhP~hgtlvTaGsDGt-f~FWDkdar~kLk~s~~~~qpI 296 (347)
T KOG0647|consen 218 IEGRVAIQYIDDPNPKDNFTFKCHRSTNSVNDDVYAVNSIAFHPVHGTLVTAGSDGT-FSFWDKDARTKLKTSETHPQPI 296 (347)
T ss_pred ecceEEEEecCCCCccCceeEEEeccCCCCCCceEEecceEeecccceEEEecCCce-EEEecchhhhhhhccCcCCCcc
Confidence 999999955443 34558888874 4899999999999999999999 99999998888887754333 3
Q ss_pred eeEEEeecCceEEEee
Q 020784 304 AQSGLWLSSAWLRVLR 319 (321)
Q Consensus 304 ~~~~~s~d~~~la~~~ 319 (321)
..-.|..+|+++|.|-
T Consensus 297 tcc~fn~~G~ifaYA~ 312 (347)
T KOG0647|consen 297 TCCSFNRNGSIFAYAL 312 (347)
T ss_pred ceeEecCCCCEEEEEe
Confidence 3447889999999874
No 46
>PTZ00420 coronin; Provisional
Probab=99.90 E-value=3.1e-21 Score=185.14 Aligned_cols=204 Identities=11% Similarity=0.129 Sum_probs=149.1
Q ss_pred cCCCCCCeEEEEEcCC-CCEEEEEcCCc-EEEEEecCCce--------eEEeeeecCCceEEEEEecCCCeEE-EEeCCC
Q 020784 81 SSSPPPTLLHISFNQD-HGCFAAGTDHG-FRIYNCDPFRE--------IFRRDFERGGGIGVVEMLFRCNILA-LVGGGP 149 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~d-g~~lasg~~~g-v~vw~~~~~~~--------~~~~~~~~~~~v~~v~~~~~~~~~~-~~sg~~ 149 (321)
...|.+.|.+++|+|+ +.+||+|+.|+ |+|||+.+... ...... |.+.|..++|++++..++ +++
T Consensus 70 L~gH~~~V~~lafsP~~~~lLASgS~DgtIrIWDi~t~~~~~~~i~~p~~~L~g-H~~~V~sVaf~P~g~~iLaSgS--- 145 (568)
T PTZ00420 70 LKGHTSSILDLQFNPCFSEILASGSEDLTIRVWEIPHNDESVKEIKDPQCILKG-HKKKISIIDWNPMNYYIMCSSG--- 145 (568)
T ss_pred EcCCCCCEEEEEEcCCCCCEEEEEeCCCeEEEEECCCCCccccccccceEEeec-CCCcEEEEEECCCCCeEEEEEe---
Confidence 3578889999999997 78999999865 88999875421 111222 678899999998876554 444
Q ss_pred CCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCe--EEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEe---
Q 020784 150 DPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDR--IIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVS--- 223 (321)
Q Consensus 150 ~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~--~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s--- 223 (321)
.|++|+|||+++++.+..+.+...|.++.|+++. +++++ ++.|+|||+++++.++++.+|........+.
T Consensus 146 ----~DgtIrIWDl~tg~~~~~i~~~~~V~SlswspdG~lLat~s~D~~IrIwD~Rsg~~i~tl~gH~g~~~s~~v~~~~ 221 (568)
T PTZ00420 146 ----FDSFVNIWDIENEKRAFQINMPKKLSSLKWNIKGNLLSGTCVGKHMHIIDPRKQEIASSFHIHDGGKNTKNIWIDG 221 (568)
T ss_pred ----CCCeEEEEECCCCcEEEEEecCCcEEEEEECCCCCEEEEEecCCEEEEEECCCCcEEEEEecccCCceeEEEEeee
Confidence 5799999999999887777777789999998764 33333 5799999999999999999887654433332
Q ss_pred eCCCceEEEeecCCC---CcEEEEeeCC--cceEEe--eccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcE
Q 020784 224 QGVGSLVLVCPGLQK---GQVRVEHYAS--KRTKFI--MAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTL 293 (321)
Q Consensus 224 ~~~d~~~la~sGs~d---g~V~i~d~~~--~~~~~l--~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~ 293 (321)
..+++.+++++|..+ +.|+|||+.. +++..+ ..+.+.+......++|.++++|+.|++ ||+|++..+.+
T Consensus 222 fs~d~~~IlTtG~d~~~~R~VkLWDlr~~~~pl~~~~ld~~~~~L~p~~D~~tg~l~lsGkGD~t-Ir~~e~~~~~~ 297 (568)
T PTZ00420 222 LGGDDNYILSTGFSKNNMREMKLWDLKNTTSALVTMSIDNASAPLIPHYDESTGLIYLIGKGDGN-CRYYQHSLGSI 297 (568)
T ss_pred EcCCCCEEEEEEcCCCCccEEEEEECCCCCCceEEEEecCCccceEEeeeCCCCCEEEEEECCCe-EEEEEccCCcE
Confidence 234556666545443 4799999884 334433 233344444445567999999999999 99999988753
No 47
>KOG0645 consensus WD40 repeat protein [General function prediction only]
Probab=99.90 E-value=2.7e-21 Score=162.94 Aligned_cols=200 Identities=14% Similarity=0.173 Sum_probs=160.9
Q ss_pred cccCCCCCCeEEEEEcCC-CCEEEEEcC-CcEEEEEecCCc---eeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCC
Q 020784 79 STSSSPPPTLLHISFNQD-HGCFAAGTD-HGFRIYNCDPFR---EIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQY 153 (321)
Q Consensus 79 ~~~~~~~~~V~~v~fs~d-g~~lasg~~-~gv~vw~~~~~~---~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~ 153 (321)
....+|.++|..++|+|- |..||+|+. +.||||+..... +.....-.|...|+.++++|.++++++++
T Consensus 8 ~~~~gh~~r~W~~awhp~~g~ilAscg~Dk~vriw~~~~~~s~~ck~vld~~hkrsVRsvAwsp~g~~La~aS------- 80 (312)
T KOG0645|consen 8 QKLSGHKDRVWSVAWHPGKGVILASCGTDKAVRIWSTSSGDSWTCKTVLDDGHKRSVRSVAWSPHGRYLASAS------- 80 (312)
T ss_pred EeecCCCCcEEEEEeccCCceEEEeecCCceEEEEecCCCCcEEEEEeccccchheeeeeeecCCCcEEEEee-------
Confidence 344678889999999998 899998887 669999987422 22122112678899999999999999888
Q ss_pred CCCcEEEEeCCC--CcEEEEEeeCC-ceeEEEEeCCe--EEEEE-CCEEEEEEcC---CcEEEEEEeccCCCCceEEEee
Q 020784 154 PLNKVMIWDDHQ--SRCIGELSFRS-EVRSVKLRRDR--IIVVL-EQKIFVYNFA---DLKLLHQIETIANPKGLCAVSQ 224 (321)
Q Consensus 154 ~d~~v~iWD~~~--~~~~~~~~~~~-~v~~v~~~~~~--~~~~~-~~~I~iwd~~---~~~~~~~l~~~~~~~~~~~~s~ 224 (321)
.|.++.||.-.. .+++..++.+. +|.+++|+.+. ++.|+ ++.|=||.+. ..+++..++.|.+.+..+.++|
T Consensus 81 FD~t~~Iw~k~~~efecv~~lEGHEnEVK~Vaws~sG~~LATCSRDKSVWiWe~deddEfec~aVL~~HtqDVK~V~WHP 160 (312)
T KOG0645|consen 81 FDATVVIWKKEDGEFECVATLEGHENEVKCVAWSASGNYLATCSRDKSVWIWEIDEDDEFECIAVLQEHTQDVKHVIWHP 160 (312)
T ss_pred ccceEEEeecCCCceeEEeeeeccccceeEEEEcCCCCEEEEeeCCCeEEEEEecCCCcEEEEeeeccccccccEEEEcC
Confidence 789999998654 45788887765 89999999765 44454 5699999985 4677888899999888888877
Q ss_pred CCCceEEEeecCCCCcEEEEeeC-Cc---ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcC
Q 020784 225 GVGSLVLVCPGLQKGQVRVEHYA-SK---RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 225 ~~d~~~la~sGs~dg~V~i~d~~-~~---~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~ 289 (321)
.. .+|+ |+++|.+|++|+.. .. ...+|.+|.+.|.+++|++.|..|+++++|++ |+||.+.
T Consensus 161 t~--dlL~-S~SYDnTIk~~~~~~dddW~c~~tl~g~~~TVW~~~F~~~G~rl~s~sdD~t-v~Iw~~~ 225 (312)
T KOG0645|consen 161 TE--DLLF-SCSYDNTIKVYRDEDDDDWECVQTLDGHENTVWSLAFDNIGSRLVSCSDDGT-VSIWRLY 225 (312)
T ss_pred Cc--ceeE-EeccCCeEEEEeecCCCCeeEEEEecCccceEEEEEecCCCceEEEecCCcc-eEeeeec
Confidence 54 5666 79999999997655 22 35689999999999999999999999999999 9999854
No 48
>KOG0265 consensus U5 snRNP-specific protein-like factor and related proteins [RNA processing and modification]
Probab=99.90 E-value=5.5e-22 Score=169.20 Aligned_cols=232 Identities=11% Similarity=0.115 Sum_probs=177.7
Q ss_pred CCCcccCCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCC
Q 020784 76 PAESTSSSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYP 154 (321)
Q Consensus 76 ~~~~~~~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~ 154 (321)
..+-...+|.+.|..+.|+.|+..|++++. +.++.||+++++..+.... |..-+..+...-.+ ...++++. .
T Consensus 81 eN~~~lkgHsgAVM~l~~~~d~s~i~S~gtDk~v~~wD~~tG~~~rk~k~-h~~~vNs~~p~rrg-~~lv~Sgs-----d 153 (338)
T KOG0265|consen 81 ENFWVLKGHSGAVMELHGMRDGSHILSCGTDKTVRGWDAETGKRIRKHKG-HTSFVNSLDPSRRG-PQLVCSGS-----D 153 (338)
T ss_pred cceeeeccccceeEeeeeccCCCEEEEecCCceEEEEecccceeeehhcc-ccceeeecCccccC-CeEEEecC-----C
Confidence 334455689999999999999998887665 6799999999988665443 45555555533233 33444544 5
Q ss_pred CCcEEEEeCCCCcEEEEEeeCCceeEEEEeCC--eEEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEE
Q 020784 155 LNKVMIWDDHQSRCIGELSFRSEVRSVKLRRD--RIIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVL 231 (321)
Q Consensus 155 d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~--~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~l 231 (321)
|+++||||+++.++++++....+++++.|... .+..+ -++.|++||+++.+..+++.+|..++.-+++++. |.++
T Consensus 154 D~t~kl~D~R~k~~~~t~~~kyqltAv~f~d~s~qv~sggIdn~ikvWd~r~~d~~~~lsGh~DtIt~lsls~~--gs~l 231 (338)
T KOG0265|consen 154 DGTLKLWDIRKKEAIKTFENKYQLTAVGFKDTSDQVISGGIDNDIKVWDLRKNDGLYTLSGHADTITGLSLSRY--GSFL 231 (338)
T ss_pred CceEEEEeecccchhhccccceeEEEEEecccccceeeccccCceeeeccccCcceEEeecccCceeeEEeccC--CCcc
Confidence 79999999999999998888889999999753 44444 4789999999999999999999988777777665 4666
Q ss_pred EeecCCCCcEEEEeeCC-----cceEEeecccc----ceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCc
Q 020784 232 VCPGLQKGQVRVEHYAS-----KRTKFIMAHDS----RIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSI 302 (321)
Q Consensus 232 a~sGs~dg~V~i~d~~~-----~~~~~l~~H~~----~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~ 302 (321)
. +-+-|.+|++||... +++..+.+|.. ....++|+|+++++..||.|+. +.|||..+..+++.+ -||.
T Consensus 232 l-snsMd~tvrvwd~rp~~p~~R~v~if~g~~hnfeknlL~cswsp~~~~i~ags~dr~-vyvwd~~~r~~lykl-pGh~ 308 (338)
T KOG0265|consen 232 L-SNSMDNTVRVWDVRPFAPSQRCVKIFQGHIHNFEKNLLKCSWSPNGTKITAGSADRF-VYVWDTTSRRILYKL-PGHY 308 (338)
T ss_pred c-cccccceEEEEEecccCCCCceEEEeecchhhhhhhcceeeccCCCCccccccccce-EEEeecccccEEEEc-CCcc
Confidence 6 588899999999863 34677777643 2456799999999999999999 999999999999888 5777
Q ss_pred ceeEE--EeecCceEEEee
Q 020784 303 SAQSG--LWLSSAWLRVLR 319 (321)
Q Consensus 303 ~~~~~--~s~d~~~la~~~ 319 (321)
..+.. |.+.-..|..++
T Consensus 309 gsvn~~~Fhp~e~iils~~ 327 (338)
T KOG0265|consen 309 GSVNEVDFHPTEPIILSCS 327 (338)
T ss_pred eeEEEeeecCCCcEEEEec
Confidence 66654 444445555443
No 49
>KOG0281 consensus Beta-TrCP (transducin repeats containing)/Slimb proteins [Function unknown]
Probab=99.90 E-value=1.7e-23 Score=181.50 Aligned_cols=192 Identities=10% Similarity=0.257 Sum_probs=151.1
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
..+|.+.|.|+.|. .+.|++|+. .+|+|||+++++.+....+ |-..| +...|..+++++++ .|++++
T Consensus 233 L~GHtGSVLCLqyd--~rviisGSSDsTvrvWDv~tge~l~tlih-HceaV--Lhlrf~ng~mvtcS-------kDrsia 300 (499)
T KOG0281|consen 233 LTGHTGSVLCLQYD--ERVIVSGSSDSTVRVWDVNTGEPLNTLIH-HCEAV--LHLRFSNGYMVTCS-------KDRSIA 300 (499)
T ss_pred hhcCCCcEEeeecc--ceEEEecCCCceEEEEeccCCchhhHHhh-hccee--EEEEEeCCEEEEec-------CCceeE
Confidence 36899999999986 458888886 5699999999987655543 33344 44556777888888 789999
Q ss_pred EEeCCCCcEEE---EE-eeCCceeEEEEeCCeEEEEEC-CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEee
Q 020784 160 IWDDHQSRCIG---EL-SFRSEVRSVKLRRDRIIVVLE-QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCP 234 (321)
Q Consensus 160 iWD~~~~~~~~---~~-~~~~~v~~v~~~~~~~~~~~~-~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~s 234 (321)
+||+.....+. -+ .+...|..|.|..+.++.+++ .+|++|++.+++.++++.+|... +.+....+ .+++ |
T Consensus 301 VWdm~sps~it~rrVLvGHrAaVNvVdfd~kyIVsASgDRTikvW~~st~efvRtl~gHkRG--IAClQYr~--rlvV-S 375 (499)
T KOG0281|consen 301 VWDMASPTDITLRRVLVGHRAAVNVVDFDDKYIVSASGDRTIKVWSTSTCEFVRTLNGHKRG--IACLQYRD--RLVV-S 375 (499)
T ss_pred EEeccCchHHHHHHHHhhhhhheeeeccccceEEEecCCceEEEEeccceeeehhhhccccc--ceehhccC--eEEE-e
Confidence 99987654221 12 233578889999887777754 59999999999999999988654 44555543 6666 7
Q ss_pred cCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCc
Q 020784 235 GLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGT 292 (321)
Q Consensus 235 Gs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~ 292 (321)
|+.|.+|++||...+. +.++.||..-|+||.|. .+.+++|++||+ |||||+.++.
T Consensus 376 GSSDntIRlwdi~~G~cLRvLeGHEeLvRciRFd--~krIVSGaYDGk-ikvWdl~aal 431 (499)
T KOG0281|consen 376 GSSDNTIRLWDIECGACLRVLEGHEELVRCIRFD--NKRIVSGAYDGK-IKVWDLQAAL 431 (499)
T ss_pred cCCCceEEEEeccccHHHHHHhchHHhhhheeec--Cceeeeccccce-EEEEeccccc
Confidence 9999999999998765 67999999999999995 578999999999 9999998764
No 50
>KOG0319 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.90 E-value=1.8e-22 Score=189.49 Aligned_cols=224 Identities=11% Similarity=0.124 Sum_probs=172.1
Q ss_pred ccCCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCcee----EEeeeecCCceEEEEEecCCCe-EEEEeCCCCCCC
Q 020784 80 TSSSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREI----FRRDFERGGGIGVVEMLFRCNI-LALVGGGPDPQY 153 (321)
Q Consensus 80 ~~~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~----~~~~~~~~~~v~~v~~~~~~~~-~~~~sg~~~~~~ 153 (321)
+-.+|...|.++....+|.+||+|+. +.+++|.++..... ..... |.+.|+.++++..+.. +++++
T Consensus 360 ii~GH~e~vlSL~~~~~g~llat~sKD~svilWr~~~~~~~~~~~a~~~g-H~~svgava~~~~~asffvsvS------- 431 (775)
T KOG0319|consen 360 IIPGHTEAVLSLDVWSSGDLLATGSKDKSVILWRLNNNCSKSLCVAQANG-HTNSVGAVAGSKLGASFFVSVS------- 431 (775)
T ss_pred EEeCchhheeeeeecccCcEEEEecCCceEEEEEecCCcchhhhhhhhcc-cccccceeeecccCccEEEEec-------
Confidence 45789999999998888999999997 56999987443221 11122 7888999988655443 44444
Q ss_pred CCCcEEEEeCCCCcE-----EE-----EEeeCCceeEEEEeCCeEEEEE---CCEEEEEEcCCcEEEEEEeccCCCCceE
Q 020784 154 PLNKVMIWDDHQSRC-----IG-----ELSFRSEVRSVKLRRDRIIVVL---EQKIFVYNFADLKLLHQIETIANPKGLC 220 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~-----~~-----~~~~~~~v~~v~~~~~~~~~~~---~~~I~iwd~~~~~~~~~l~~~~~~~~~~ 220 (321)
.|.++|+|++...+. +. ...|+..|.+|++.++.-++++ |++.+||++.+.++..++.+|...+.++
T Consensus 432 ~D~tlK~W~l~~s~~~~~~~~~~~~~t~~aHdKdIN~Vaia~ndkLiAT~SqDktaKiW~le~~~l~~vLsGH~RGvw~V 511 (775)
T KOG0319|consen 432 QDCTLKLWDLPKSKETAFPIVLTCRYTERAHDKDINCVAIAPNDKLIATGSQDKTAKIWDLEQLRLLGVLSGHTRGVWCV 511 (775)
T ss_pred CCceEEEecCCCcccccccceehhhHHHHhhcccccceEecCCCceEEecccccceeeecccCceEEEEeeCCccceEEE
Confidence 689999999876221 11 1224568999999987655553 4699999999999999999998766666
Q ss_pred EEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeC
Q 020784 221 AVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECC 299 (321)
Q Consensus 221 ~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~ 299 (321)
.|++. .+++| ++|.|++|+||.+.+.. +++|.||...|..+.|-.+|..|+||+.||- ||||++++++|+.++.
T Consensus 512 ~Fs~~--dq~la-T~SgD~TvKIW~is~fSClkT~eGH~~aVlra~F~~~~~qliS~~adGl-iKlWnikt~eC~~tlD- 586 (775)
T KOG0319|consen 512 SFSKN--DQLLA-TCSGDKTVKIWSISTFSCLKTFEGHTSAVLRASFIRNGKQLISAGADGL-IKLWNIKTNECEMTLD- 586 (775)
T ss_pred Eeccc--cceeE-eccCCceEEEEEeccceeeeeecCccceeEeeeeeeCCcEEEeccCCCc-EEEEeccchhhhhhhh-
Confidence 66654 37888 59999999999998765 8899999999999999999999999999999 9999999999999995
Q ss_pred CCcceeEEE--eecCceEE
Q 020784 300 PSISAQSGL--WLSSAWLR 316 (321)
Q Consensus 300 g~~~~~~~~--s~d~~~la 316 (321)
+|....=++ ++.+..+.
T Consensus 587 ~H~DrvWaL~~~~~~~~~~ 605 (775)
T KOG0319|consen 587 AHNDRVWALSVSPLLDMFV 605 (775)
T ss_pred hccceeEEEeecCccceeE
Confidence 555444333 44445443
No 51
>KOG0650 consensus WD40 repeat nucleolar protein Bop1, involved in ribosome biogenesis [Translation, ribosomal structure and biogenesis]
Probab=99.90 E-value=7.6e-23 Score=188.02 Aligned_cols=225 Identities=20% Similarity=0.299 Sum_probs=171.2
Q ss_pred CCCCCCCCCCCCCCCCCCCCCCCCcccCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEE
Q 020784 55 PDSFSPSIPESNPNYQMPLPSPAESTSSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVV 133 (321)
Q Consensus 55 p~~~~p~~~~~~~~~~~~~~~~~~~~~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v 133 (321)
|++..|.+|. +....+.+.......++|.+.|+||+..|.|.+||+|+++| ||||.+.+++++.+..+ ++.|.+|
T Consensus 372 pe~LiPkLPs--p~dLrPFPt~~~lvyrGHtg~Vr~iSvdp~G~wlasGsdDGtvriWEi~TgRcvr~~~~--d~~I~~v 447 (733)
T KOG0650|consen 372 PESLIPKLPS--PKDLRPFPTRCALVYRGHTGLVRSISVDPSGEWLASGSDDGTVRIWEIATGRCVRTVQF--DSEIRSV 447 (733)
T ss_pred HHHhcccCCC--hhhcCCCcceeeeeEeccCCeEEEEEecCCcceeeecCCCCcEEEEEeecceEEEEEee--cceeEEE
Confidence 4556666664 44444445456666789999999999999999999999976 88999999999999888 8899999
Q ss_pred EEecCCC--eEEEEeCCCC-------------------------CCCCCCcEEEEeCC---CC--cEEEEEeeCCceeEE
Q 020784 134 EMLFRCN--ILALVGGGPD-------------------------PQYPLNKVMIWDDH---QS--RCIGELSFRSEVRSV 181 (321)
Q Consensus 134 ~~~~~~~--~~~~~sg~~~-------------------------~~~~d~~v~iWD~~---~~--~~~~~~~~~~~v~~v 181 (321)
+|.+.++ .+|++.+... -..-++++..|.-. .+ .....+.+...|.++
T Consensus 448 aw~P~~~~~vLAvA~~~~~~ivnp~~G~~~e~~~t~ell~~~~~~~~p~~~~~~W~~~~~~e~~~~v~~~I~~~k~i~~v 527 (733)
T KOG0650|consen 448 AWNPLSDLCVLAVAVGECVLIVNPIFGDRLEVGPTKELLASAPNESEPDAAVVTWSRASLDELEKGVCIVIKHPKSIRQV 527 (733)
T ss_pred EecCCCCceeEEEEecCceEEeCccccchhhhcchhhhhhcCCCccCCcccceeechhhhhhhccceEEEEecCCcccee
Confidence 9988664 3444433320 01224667788633 11 122334444455555
Q ss_pred EEeCC-----------------------------------------------eEEEEECCEEEEEEcCCcEEEEEEeccC
Q 020784 182 KLRRD-----------------------------------------------RIIVVLEQKIFVYNFADLKLLHQIETIA 214 (321)
Q Consensus 182 ~~~~~-----------------------------------------------~~~~~~~~~I~iwd~~~~~~~~~l~~~~ 214 (321)
.||++ .+++++...|||||+..+++++++....
T Consensus 528 tWHrkGDYlatV~~~~~~~~VliHQLSK~~sQ~PF~kskG~vq~v~FHPs~p~lfVaTq~~vRiYdL~kqelvKkL~tg~ 607 (733)
T KOG0650|consen 528 TWHRKGDYLATVMPDSGNKSVLIHQLSKRKSQSPFRKSKGLVQRVKFHPSKPYLFVATQRSVRIYDLSKQELVKKLLTGS 607 (733)
T ss_pred eeecCCceEEEeccCCCcceEEEEecccccccCchhhcCCceeEEEecCCCceEEEEeccceEEEehhHHHHHHHHhcCC
Confidence 55543 5788889999999998888888888888
Q ss_pred CCCceEEEeeCCCceEEEeecCCCCcEEEEeeC--CcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEE
Q 020784 215 NPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYA--SKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 215 ~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~--~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd 287 (321)
.++..+++++.+|+. ++ |+.|+.++++|+. ++++++++.|...|++|+|++.-.+||+||.||+ +.||-
T Consensus 608 kwiS~msihp~GDnl-i~--gs~d~k~~WfDldlsskPyk~lr~H~~avr~Va~H~ryPLfas~sdDgt-v~Vfh 678 (733)
T KOG0650|consen 608 KWISSMSIHPNGDNL-IL--GSYDKKMCWFDLDLSSKPYKTLRLHEKAVRSVAFHKRYPLFASGSDDGT-VIVFH 678 (733)
T ss_pred eeeeeeeecCCCCeE-EE--ecCCCeeEEEEcccCcchhHHhhhhhhhhhhhhhccccceeeeecCCCc-EEEEe
Confidence 888889999988753 33 8999999997765 5678899999999999999999999999999999 88884
No 52
>KOG0274 consensus Cdc4 and related F-box and WD-40 proteins [General function prediction only]
Probab=99.89 E-value=2.7e-21 Score=184.83 Aligned_cols=203 Identities=16% Similarity=0.229 Sum_probs=166.3
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
..+|.+.|.+++|..-+.+|++|+. .+++|||+.++++...... |...+.++.. ....+. +|+ .|.+|+
T Consensus 245 l~GH~g~V~~l~~~~~~~~lvsgS~D~t~rvWd~~sg~C~~~l~g-h~stv~~~~~--~~~~~~--sgs-----~D~tVk 314 (537)
T KOG0274|consen 245 LVGHFGGVWGLAFPSGGDKLVSGSTDKTERVWDCSTGECTHSLQG-HTSSVRCLTI--DPFLLV--SGS-----RDNTVK 314 (537)
T ss_pred ccCCCCCceeEEEecCCCEEEEEecCCcEEeEecCCCcEEEEecC-CCceEEEEEc--cCceEe--ecc-----CCceEE
Confidence 3689999999999997888999985 7799999999999877764 5555655543 233333 333 579999
Q ss_pred EEeCCCCcEEEEEe-eCCceeEEEEeCCeEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCC
Q 020784 160 IWDDHQSRCIGELS-FRSEVRSVKLRRDRIIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQ 237 (321)
Q Consensus 160 iWD~~~~~~~~~~~-~~~~v~~v~~~~~~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~ 237 (321)
+||+.++.++..+. +...|.++..+.+.++.++ +++|++||+.++++++++.+|...+....+ ++. ..+. +|+.
T Consensus 315 VW~v~n~~~l~l~~~h~~~V~~v~~~~~~lvsgs~d~~v~VW~~~~~~cl~sl~gH~~~V~sl~~--~~~-~~~~-Sgs~ 390 (537)
T KOG0274|consen 315 VWDVTNGACLNLLRGHTGPVNCVQLDEPLLVSGSYDGTVKVWDPRTGKCLKSLSGHTGRVYSLIV--DSE-NRLL-SGSL 390 (537)
T ss_pred EEeccCcceEEEeccccccEEEEEecCCEEEEEecCceEEEEEhhhceeeeeecCCcceEEEEEe--cCc-ceEE-eeee
Confidence 99999999999998 6679999999988877775 569999999999999999998776555433 332 3444 7999
Q ss_pred CCcEEEEeeCCc--ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCC
Q 020784 238 KGQVRVEHYASK--RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCP 300 (321)
Q Consensus 238 dg~V~i~d~~~~--~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g 300 (321)
|+.|++||+.++ .++++.+|.+.|.++.+ .+++|++++.|++ ||+||..++++++++...
T Consensus 391 D~~IkvWdl~~~~~c~~tl~~h~~~v~~l~~--~~~~Lvs~~aD~~-Ik~WD~~~~~~~~~~~~~ 452 (537)
T KOG0274|consen 391 DTTIKVWDLRTKRKCIHTLQGHTSLVSSLLL--RDNFLVSSSADGT-IKLWDAEEGECLRTLEGR 452 (537)
T ss_pred ccceEeecCCchhhhhhhhcCCccccccccc--ccceeEecccccc-EEEeecccCceeeeeccC
Confidence 999999999987 57899999999977766 4789999999999 999999999999999653
No 53
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.89 E-value=1.3e-21 Score=161.90 Aligned_cols=231 Identities=16% Similarity=0.158 Sum_probs=177.7
Q ss_pred CCCCCCCCCCcccCCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeC
Q 020784 69 YQMPLPSPAESTSSSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGG 147 (321)
Q Consensus 69 ~~~~~~~~~~~~~~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg 147 (321)
+|++..........+|..+|..++.+.|...|++|+. +.+.+||+.+++....+.. |.+.|..+.+.-+...+ ++|
T Consensus 43 LWNp~rg~liktYsghG~EVlD~~~s~Dnskf~s~GgDk~v~vwDV~TGkv~Rr~rg-H~aqVNtV~fNeesSVv--~Sg 119 (307)
T KOG0316|consen 43 LWNPLRGALIKTYSGHGHEVLDAALSSDNSKFASCGGDKAVQVWDVNTGKVDRRFRG-HLAQVNTVRFNEESSVV--ASG 119 (307)
T ss_pred eecccccceeeeecCCCceeeeccccccccccccCCCCceEEEEEcccCeeeeeccc-ccceeeEEEecCcceEE--Eec
Confidence 6777776666677788899999999999988886655 6688999999998766554 67788887765555444 444
Q ss_pred CCCCCCCCCcEEEEeCCCC--cEEEEEee-CCceeEEEEeCCeEEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEe
Q 020784 148 GPDPQYPLNKVMIWDDHQS--RCIGELSF-RSEVRSVKLRRDRIIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVS 223 (321)
Q Consensus 148 ~~~~~~~d~~v~iWD~~~~--~~~~~~~~-~~~v~~v~~~~~~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s 223 (321)
+ .|.++++||.+.. +.++.+.. ...|.++.+....++.+ .|+++|.||++.+++....-+ +++.+++|+
T Consensus 120 s-----fD~s~r~wDCRS~s~ePiQildea~D~V~Si~v~~heIvaGS~DGtvRtydiR~G~l~sDy~g--~pit~vs~s 192 (307)
T KOG0316|consen 120 S-----FDSSVRLWDCRSRSFEPIQILDEAKDGVSSIDVAEHEIVAGSVDGTVRTYDIRKGTLSSDYFG--HPITSVSFS 192 (307)
T ss_pred c-----ccceeEEEEcccCCCCccchhhhhcCceeEEEecccEEEeeccCCcEEEEEeecceeehhhcC--CcceeEEec
Confidence 4 6799999999865 45666543 34799999988777666 478999999999987655443 577788888
Q ss_pred eCCCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccc--eeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCC
Q 020784 224 QGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSR--IACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCP 300 (321)
Q Consensus 224 ~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~--V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g 300 (321)
.+++ ..|| |+-|+++++.|-.++. +..+++|.+. =..++++....++++||+||. |.+||+..++.+..+...
T Consensus 193 ~d~n-c~La--~~l~stlrLlDk~tGklL~sYkGhkn~eykldc~l~qsdthV~sgSEDG~-Vy~wdLvd~~~~sk~~~~ 268 (307)
T KOG0316|consen 193 KDGN-CSLA--SSLDSTLRLLDKETGKLLKSYKGHKNMEYKLDCCLNQSDTHVFSGSEDGK-VYFWDLVDETQISKLSVV 268 (307)
T ss_pred CCCC-EEEE--eeccceeeecccchhHHHHHhcccccceeeeeeeecccceeEEeccCCce-EEEEEeccceeeeeeccC
Confidence 7653 3444 7999999998887766 5689999875 345677888889999999999 999999999999999766
Q ss_pred CcceeEEEeecCc
Q 020784 301 SISAQSGLWLSSA 313 (321)
Q Consensus 301 ~~~~~~~~s~d~~ 313 (321)
.......++.-+.
T Consensus 269 ~~v~v~dl~~hp~ 281 (307)
T KOG0316|consen 269 STVIVTDLSCHPT 281 (307)
T ss_pred CceeEEeeecccC
Confidence 6655556665553
No 54
>KOG0274 consensus Cdc4 and related F-box and WD-40 proteins [General function prediction only]
Probab=99.89 E-value=1.3e-21 Score=187.08 Aligned_cols=216 Identities=16% Similarity=0.226 Sum_probs=173.7
Q ss_pred CCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEE-eeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 84 PPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFR-RDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~-~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
+...|.|..|. +.++.+|++ ..+++|+..++..+.. ... |.+.+..+++...++.+++++ .|+++|||
T Consensus 207 ~~~~~~~~q~~--~~~~~~~s~~~tl~~~~~~~~~~i~~~l~G-H~g~V~~l~~~~~~~~lvsgS-------~D~t~rvW 276 (537)
T KOG0274|consen 207 DDHVVLCLQLH--DGFFKSGSDDSTLHLWDLNNGYLILTRLVG-HFGGVWGLAFPSGGDKLVSGS-------TDKTERVW 276 (537)
T ss_pred Ccchhhhheee--cCeEEecCCCceeEEeecccceEEEeeccC-CCCCceeEEEecCCCEEEEEe-------cCCcEEeE
Confidence 45578888888 456777776 5577999999887766 443 788899988876677887777 78999999
Q ss_pred eCCCCcEEEEEeeCC-ceeEEEEeCCeEEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCC
Q 020784 162 DDHQSRCIGELSFRS-EVRSVKLRRDRIIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKG 239 (321)
Q Consensus 162 D~~~~~~~~~~~~~~-~v~~v~~~~~~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg 239 (321)
|+.+|+|...+..+. .|.++...+..+..+ .|.+|++|++.+++.++.+.+|..++..+.+. +.+++ +|+.||
T Consensus 277 d~~sg~C~~~l~gh~stv~~~~~~~~~~~sgs~D~tVkVW~v~n~~~l~l~~~h~~~V~~v~~~----~~~lv-sgs~d~ 351 (537)
T KOG0274|consen 277 DCSTGECTHSLQGHTSSVRCLTIDPFLLVSGSRDNTVKVWDVTNGACLNLLRGHTGPVNCVQLD----EPLLV-SGSYDG 351 (537)
T ss_pred ecCCCcEEEEecCCCceEEEEEccCceEeeccCCceEEEEeccCcceEEEeccccccEEEEEec----CCEEE-EEecCc
Confidence 999999999998654 677777777666664 46799999999999999999877766655554 25565 699999
Q ss_pred cEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCC-cEEEEEeCCCcceeEEEeecCceEEE
Q 020784 240 QVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDG-TLLQEECCPSISAQSGLWLSSAWLRV 317 (321)
Q Consensus 240 ~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg-~~i~~~~~g~~~~~~~~s~d~~~la~ 317 (321)
+|++|+..+.. ++++.+|...|.++.+... .++.+||.|++ ||+||++++ +|++++ .+|......+...+++|--
T Consensus 352 ~v~VW~~~~~~cl~sl~gH~~~V~sl~~~~~-~~~~Sgs~D~~-IkvWdl~~~~~c~~tl-~~h~~~v~~l~~~~~~Lvs 428 (537)
T KOG0274|consen 352 TVKVWDPRTGKCLKSLSGHTGRVYSLIVDSE-NRLLSGSLDTT-IKVWDLRTKRKCIHTL-QGHTSLVSSLLLRDNFLVS 428 (537)
T ss_pred eEEEEEhhhceeeeeecCCcceEEEEEecCc-ceEEeeeeccc-eEeecCCchhhhhhhh-cCCcccccccccccceeEe
Confidence 99999998755 7899999999999988765 88999999999 999999999 999998 4666655566666666543
No 55
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=99.89 E-value=3.7e-21 Score=171.14 Aligned_cols=223 Identities=10% Similarity=0.121 Sum_probs=173.7
Q ss_pred CCeEEEEEcCCCCEEEEEcCC-cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC
Q 020784 86 PTLLHISFNQDHGCFAAGTDH-GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH 164 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~-gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~ 164 (321)
..++++...+....++||+.| .+.++|....+.+..... |...|..+.++++...++.++ .|..|+||..-
T Consensus 220 pgi~ald~~~s~~~ilTGG~d~~av~~d~~s~q~l~~~~G-h~kki~~v~~~~~~~~v~~aS-------ad~~i~vws~~ 291 (506)
T KOG0289|consen 220 PGITALDIIPSSSKILTGGEDKTAVLFDKPSNQILATLKG-HTKKITSVKFHKDLDTVITAS-------ADEIIRVWSVP 291 (506)
T ss_pred CCeeEEeecCCCCcceecCCCCceEEEecchhhhhhhccC-cceEEEEEEeccchhheeecC-------CcceEEeeccc
Confidence 368888888877788999986 788999988877666653 444555556566555555555 67899999986
Q ss_pred CCcEEEEE-eeCCceeEEEEeC--CeEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCc
Q 020784 165 QSRCIGEL-SFRSEVRSVKLRR--DRIIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQ 240 (321)
Q Consensus 165 ~~~~~~~~-~~~~~v~~v~~~~--~~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~ 240 (321)
........ .+...|+.+..|+ +.++.+. +++..+.|++++..+.........+...+..++|||.+++ .|..||.
T Consensus 292 ~~s~~~~~~~h~~~V~~ls~h~tgeYllsAs~d~~w~Fsd~~~g~~lt~vs~~~s~v~~ts~~fHpDgLifg-tgt~d~~ 370 (506)
T KOG0289|consen 292 LSSEPTSSRPHEEPVTGLSLHPTGEYLLSASNDGTWAFSDISSGSQLTVVSDETSDVEYTSAAFHPDGLIFG-TGTPDGV 370 (506)
T ss_pred cccCccccccccccceeeeeccCCcEEEEecCCceEEEEEccCCcEEEEEeeccccceeEEeeEcCCceEEe-ccCCCce
Confidence 65543333 3456788888876 4565555 4699999999998887776544556677777788889998 5999999
Q ss_pred EEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCc--ceeEEEeecCceEEE
Q 020784 241 VRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSI--SAQSGLWLSSAWLRV 317 (321)
Q Consensus 241 V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~--~~~~~~s~d~~~la~ 317 (321)
|+|||+.... ...|.+|.++|..|+|+.||.+||++++|+. |++||++..+.++++..... ...+.|-.+|+||+.
T Consensus 371 vkiwdlks~~~~a~Fpght~~vk~i~FsENGY~Lat~add~~-V~lwDLRKl~n~kt~~l~~~~~v~s~~fD~SGt~L~~ 449 (506)
T KOG0289|consen 371 VKIWDLKSQTNVAKFPGHTGPVKAISFSENGYWLATAADDGS-VKLWDLRKLKNFKTIQLDEKKEVNSLSFDQSGTYLGI 449 (506)
T ss_pred EEEEEcCCccccccCCCCCCceeEEEeccCceEEEEEecCCe-EEEEEehhhcccceeeccccccceeEEEcCCCCeEEe
Confidence 9999998765 5589999999999999999999999999999 99999999999998864443 334477788899987
Q ss_pred e
Q 020784 318 L 318 (321)
Q Consensus 318 ~ 318 (321)
+
T Consensus 450 ~ 450 (506)
T KOG0289|consen 450 A 450 (506)
T ss_pred e
Confidence 5
No 56
>KOG0282 consensus mRNA splicing factor [Function unknown]
Probab=99.89 E-value=8.3e-23 Score=183.72 Aligned_cols=196 Identities=15% Similarity=0.203 Sum_probs=154.8
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCC-cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDH-GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~-gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
.+|..+|+.++|+++|+.|.+++-| .+++||++++++....+. +....++.+.++...+.++|+ .|+.|+.
T Consensus 255 ~gH~k~Vrd~~~s~~g~~fLS~sfD~~lKlwDtETG~~~~~f~~--~~~~~cvkf~pd~~n~fl~G~------sd~ki~~ 326 (503)
T KOG0282|consen 255 KGHRKPVRDASFNNCGTSFLSASFDRFLKLWDTETGQVLSRFHL--DKVPTCVKFHPDNQNIFLVGG------SDKKIRQ 326 (503)
T ss_pred hcchhhhhhhhccccCCeeeeeecceeeeeeccccceEEEEEec--CCCceeeecCCCCCcEEEEec------CCCcEEE
Confidence 5788899999999999999988865 588999999999877774 778899999998855656654 5799999
Q ss_pred EeCCCCcEEEEEeeC-CceeEEEEeCC--eEEEEEC-CEEEEEEcCCcEEEE----------------------------
Q 020784 161 WDDHQSRCIGELSFR-SEVRSVKLRRD--RIIVVLE-QKIFVYNFADLKLLH---------------------------- 208 (321)
Q Consensus 161 WD~~~~~~~~~~~~~-~~v~~v~~~~~--~~~~~~~-~~I~iwd~~~~~~~~---------------------------- 208 (321)
||+++++.++++..+ +.|..+.|-++ +++..++ +.++||+.+..-.++
T Consensus 327 wDiRs~kvvqeYd~hLg~i~~i~F~~~g~rFissSDdks~riWe~~~~v~ik~i~~~~~hsmP~~~~~P~~~~~~aQs~d 406 (503)
T KOG0282|consen 327 WDIRSGKVVQEYDRHLGAILDITFVDEGRRFISSSDDKSVRIWENRIPVPIKNIADPEMHTMPCLTLHPNGKWFAAQSMD 406 (503)
T ss_pred EeccchHHHHHHHhhhhheeeeEEccCCceEeeeccCccEEEEEcCCCccchhhcchhhccCcceecCCCCCeehhhccC
Confidence 999999988877655 47778887543 4555544 699999886432221
Q ss_pred ------------------EEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCC
Q 020784 209 ------------------QIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQD 269 (321)
Q Consensus 209 ------------------~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspd 269 (321)
.|++|......|.+.+.||+.+|+ +|+.||.+.+||+++.. +..+++|+..|..+.|+|-
T Consensus 407 N~i~ifs~~~~~r~nkkK~feGh~vaGys~~v~fSpDG~~l~-SGdsdG~v~~wdwkt~kl~~~lkah~~~ci~v~wHP~ 485 (503)
T KOG0282|consen 407 NYIAIFSTVPPFRLNKKKRFEGHSVAGYSCQVDFSPDGRTLC-SGDSDGKVNFWDWKTTKLVSKLKAHDQPCIGVDWHPV 485 (503)
T ss_pred ceEEEEecccccccCHhhhhcceeccCceeeEEEcCCCCeEE-eecCCccEEEeechhhhhhhccccCCcceEEEEecCC
Confidence 123333333456666667889998 69999999999998755 5689999999999999986
Q ss_pred -CCEEEEEeCCCcEEEEEE
Q 020784 270 -GQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 270 -g~~las~S~Dgt~IrIWd 287 (321)
...+|||++||. |+|||
T Consensus 486 e~Skvat~~w~G~-Ikiwd 503 (503)
T KOG0282|consen 486 EPSKVATCGWDGL-IKIWD 503 (503)
T ss_pred CcceeEecccCce-eEecC
Confidence 468999999999 99996
No 57
>KOG0306 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.89 E-value=1.9e-21 Score=182.84 Aligned_cols=226 Identities=16% Similarity=0.183 Sum_probs=179.8
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeee-------------------------------------
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDF------------------------------------- 124 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~------------------------------------- 124 (321)
.+|++.|++++|+.|...+++|+.+.++||+.++.+++...+.
T Consensus 370 ~GHR~dVRsl~vS~d~~~~~Sga~~SikiWn~~t~kciRTi~~~y~l~~~Fvpgd~~Iv~G~k~Gel~vfdlaS~~l~Et 449 (888)
T KOG0306|consen 370 GGHRSDVRSLCVSSDSILLASGAGESIKIWNRDTLKCIRTITCGYILASKFVPGDRYIVLGTKNGELQVFDLASASLVET 449 (888)
T ss_pred ccchhheeEEEeecCceeeeecCCCcEEEEEccCcceeEEeccccEEEEEecCCCceEEEeccCCceEEEEeehhhhhhh
Confidence 5799999999999999999999999999999988776554432
Q ss_pred --ecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCC-----C---c-----EEEEEeeCCceeEEEEeCCe--
Q 020784 125 --ERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQ-----S---R-----CIGELSFRSEVRSVKLRRDR-- 187 (321)
Q Consensus 125 --~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~-----~---~-----~~~~~~~~~~v~~v~~~~~~-- 187 (321)
.|++.+..++..+++..+++++ .|++|++||..- + + ..+++++...|.++.++|+.
T Consensus 450 i~AHdgaIWsi~~~pD~~g~vT~s-------aDktVkfWdf~l~~~~~gt~~k~lsl~~~rtLel~ddvL~v~~Spdgk~ 522 (888)
T KOG0306|consen 450 IRAHDGAIWSISLSPDNKGFVTGS-------ADKTVKFWDFKLVVSVPGTQKKVLSLKHTRTLELEDDVLCVSVSPDGKL 522 (888)
T ss_pred hhccccceeeeeecCCCCceEEec-------CCcEEEEEeEEEEeccCcccceeeeeccceEEeccccEEEEEEcCCCcE
Confidence 0334444444444444444444 689999999531 1 1 11356677889999999875
Q ss_pred EEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcce-EEeeccccceeEEE
Q 020784 188 IIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRT-KFIMAHDSRIACFA 265 (321)
Q Consensus 188 ~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~-~~l~~H~~~V~~va 265 (321)
++++ .+++|++|-+.+.+..-++-+|.-|+.++.++++. .+++ +|+.|+.|+||-+..+.. +.+-+|+..|.+|.
T Consensus 523 LaVsLLdnTVkVyflDtlKFflsLYGHkLPV~smDIS~DS--kliv-TgSADKnVKiWGLdFGDCHKS~fAHdDSvm~V~ 599 (888)
T KOG0306|consen 523 LAVSLLDNTVKVYFLDTLKFFLSLYGHKLPVLSMDISPDS--KLIV-TGSADKNVKIWGLDFGDCHKSFFAHDDSVMSVQ 599 (888)
T ss_pred EEEEeccCeEEEEEecceeeeeeecccccceeEEeccCCc--CeEE-eccCCCceEEeccccchhhhhhhcccCceeEEE
Confidence 3443 47899999999999999999999999999998865 7777 599999999999887764 58999999999999
Q ss_pred ECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcce-eEEEeecCceEEEe
Q 020784 266 LTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISA-QSGLWLSSAWLRVL 318 (321)
Q Consensus 266 fspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~-~~~~s~d~~~la~~ 318 (321)
|-|+..+|.|||.|+. ||-||-...++++++...+... .++.+++|.|+..+
T Consensus 600 F~P~~~~FFt~gKD~k-vKqWDg~kFe~iq~L~~H~~ev~cLav~~~G~~vvs~ 652 (888)
T KOG0306|consen 600 FLPKTHLFFTCGKDGK-VKQWDGEKFEEIQKLDGHHSEVWCLAVSPNGSFVVSS 652 (888)
T ss_pred EcccceeEEEecCcce-EEeechhhhhhheeeccchheeeeeEEcCCCCeEEec
Confidence 9999999999999999 9999999999999996444333 45778999988654
No 58
>KOG0273 consensus Beta-transducin family (WD-40 repeat) protein [Chromatin structure and dynamics]
Probab=99.89 E-value=4.7e-21 Score=172.02 Aligned_cols=197 Identities=14% Similarity=0.185 Sum_probs=160.1
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCce------------------------------eEEeee------
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFRE------------------------------IFRRDF------ 124 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~------------------------------~~~~~~------ 124 (321)
..|+++|.++.|+.+|+||++|+.|+ +.+||..++.. ++....
T Consensus 273 ~~HkgPI~slKWnk~G~yilS~~vD~ttilwd~~~g~~~q~f~~~s~~~lDVdW~~~~~F~ts~td~~i~V~kv~~~~P~ 352 (524)
T KOG0273|consen 273 GQHKGPIFSLKWNKKGTYILSGGVDGTTILWDAHTGTVKQQFEFHSAPALDVDWQSNDEFATSSTDGCIHVCKVGEDRPV 352 (524)
T ss_pred hccCCceEEEEEcCCCCEEEeccCCccEEEEeccCceEEEeeeeccCCccceEEecCceEeecCCCceEEEEEecCCCcc
Confidence 56889999999999999999999865 67999733221 111111
Q ss_pred ---e-cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeC-CceeEEEEeCC-----------eE
Q 020784 125 ---E-RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFR-SEVRSVKLRRD-----------RI 188 (321)
Q Consensus 125 ---~-~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~-~~v~~v~~~~~-----------~~ 188 (321)
. |.+.|.+++|.+.+.+|++++ +|+|+|||.+....+...++.+ .+|+.+.|+|. .+
T Consensus 353 ~t~~GH~g~V~alk~n~tg~LLaS~S-------dD~TlkiWs~~~~~~~~~l~~Hskei~t~~wsp~g~v~~n~~~~~~l 425 (524)
T KOG0273|consen 353 KTFIGHHGEVNALKWNPTGSLLASCS-------DDGTLKIWSMGQSNSVHDLQAHSKEIYTIKWSPTGPVTSNPNMNLML 425 (524)
T ss_pred eeeecccCceEEEEECCCCceEEEec-------CCCeeEeeecCCCcchhhhhhhccceeeEeecCCCCccCCCcCCceE
Confidence 0 677889999988899999888 7899999999888887777655 48999998764 23
Q ss_pred E-EEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEEeeccccceeEEEEC
Q 020784 189 I-VVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKFIMAHDSRIACFALT 267 (321)
Q Consensus 189 ~-~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafs 267 (321)
+ +..+++|++||+..+.++++|..|..++..++|+++ +.++| +|+.||.|.||+.++..+..-..-++.|..|+|+
T Consensus 426 ~sas~dstV~lwdv~~gv~i~~f~kH~~pVysvafS~~--g~ylA-sGs~dg~V~iws~~~~~l~~s~~~~~~Ifel~Wn 502 (524)
T KOG0273|consen 426 ASASFDSTVKLWDVESGVPIHTLMKHQEPVYSVAFSPN--GRYLA-SGSLDGCVHIWSTKTGKLVKSYQGTGGIFELCWN 502 (524)
T ss_pred EEeecCCeEEEEEccCCceeEeeccCCCceEEEEecCC--CcEEE-ecCCCCeeEeccccchheeEeecCCCeEEEEEEc
Confidence 3 345789999999999999999999888887777775 49999 6999999999999888766545566779999999
Q ss_pred CCCCEEEEEeCCCcEEEEEEcC
Q 020784 268 QDGQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 268 pdg~~las~S~Dgt~IrIWd~~ 289 (321)
-+|.+|..+-.|+. +.+-|++
T Consensus 503 ~~G~kl~~~~sd~~-vcvldlr 523 (524)
T KOG0273|consen 503 AAGDKLGACASDGS-VCVLDLR 523 (524)
T ss_pred CCCCEEEEEecCCC-ceEEEec
Confidence 99999998888999 9999876
No 59
>KOG0288 consensus WD40 repeat protein TipD [General function prediction only]
Probab=99.89 E-value=5.5e-22 Score=175.40 Aligned_cols=223 Identities=16% Similarity=0.231 Sum_probs=166.7
Q ss_pred CCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 83 SPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
+..+.|+++.|.++++++++++. +.+++|+++..+....... |.+.|..+.+.-.... +++|+ .|.+||+|
T Consensus 217 Gs~g~it~~d~d~~~~~~iAas~d~~~r~Wnvd~~r~~~TLsG-HtdkVt~ak~~~~~~~--vVsgs-----~DRtiK~W 288 (459)
T KOG0288|consen 217 GSLGNITSIDFDSDNKHVIAASNDKNLRLWNVDSLRLRHTLSG-HTDKVTAAKFKLSHSR--VVSGS-----ADRTIKLW 288 (459)
T ss_pred ccCCCcceeeecCCCceEEeecCCCceeeeeccchhhhhhhcc-cccceeeehhhccccc--eeecc-----ccchhhhh
Confidence 44568999999999998776665 5589999999887766665 6777777766433322 44544 68999999
Q ss_pred eCCCCcEEEEEeeCCceeEEEEeCCeEEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCc
Q 020784 162 DDHQSRCIGELSFRSEVRSVKLRRDRIIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQ 240 (321)
Q Consensus 162 D~~~~~~~~~~~~~~~v~~v~~~~~~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~ 240 (321)
|+++..|..++-..+.+..++.....++.. .+++||+||++...+.+.+..+. -+..+.++++ +.-+.. .+-|.+
T Consensus 289 Dl~k~~C~kt~l~~S~cnDI~~~~~~~~SgH~DkkvRfwD~Rs~~~~~sv~~gg-~vtSl~ls~~--g~~lLs-ssRDdt 364 (459)
T KOG0288|consen 289 DLQKAYCSKTVLPGSQCNDIVCSISDVISGHFDKKVRFWDIRSADKTRSVPLGG-RVTSLDLSMD--GLELLS-SSRDDT 364 (459)
T ss_pred hhhhhheeccccccccccceEecceeeeecccccceEEEeccCCceeeEeecCc-ceeeEeeccC--CeEEee-ecCCCc
Confidence 999999988877777777777764333443 46799999999999988888764 3445555554 454543 477889
Q ss_pred EEEEeeCCcceE-Eeecc----ccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcc-eeEEEeec--C
Q 020784 241 VRVEHYASKRTK-FIMAH----DSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSIS-AQSGLWLS--S 312 (321)
Q Consensus 241 V~i~d~~~~~~~-~l~~H----~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~-~~~~~s~d--~ 312 (321)
+.+.|..+..+. ++.+- ...++.+.|||++.|+|+||.||. |+||++.+|++...++..+.. ++.+++|+ |
T Consensus 365 l~viDlRt~eI~~~~sA~g~k~asDwtrvvfSpd~~YvaAGS~dgs-v~iW~v~tgKlE~~l~~s~s~~aI~s~~W~~sG 443 (459)
T KOG0288|consen 365 LKVIDLRTKEIRQTFSAEGFKCASDWTRVVFSPDGSYVAAGSADGS-VYIWSVFTGKLEKVLSLSTSNAAITSLSWNPSG 443 (459)
T ss_pred eeeeecccccEEEEeeccccccccccceeEECCCCceeeeccCCCc-EEEEEccCceEEEEeccCCCCcceEEEEEcCCC
Confidence 999998876644 44321 233899999999999999999999 999999999999998776665 55566554 5
Q ss_pred ceEEEe
Q 020784 313 AWLRVL 318 (321)
Q Consensus 313 ~~la~~ 318 (321)
.+|..|
T Consensus 444 ~~Llsa 449 (459)
T KOG0288|consen 444 SGLLSA 449 (459)
T ss_pred chhhcc
Confidence 666543
No 60
>KOG1407 consensus WD40 repeat protein [Function unknown]
Probab=99.89 E-value=1.3e-20 Score=158.04 Aligned_cols=225 Identities=14% Similarity=0.166 Sum_probs=182.4
Q ss_pred cCCCCCCeEEEEEcCC-CCEEEEEc-CCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcE
Q 020784 81 SSSPPPTLLHISFNQD-HGCFAAGT-DHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~d-g~~lasg~-~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
.++|.+.|--++|+|. ..+|++++ ++.|++||....+.....+. .++-..+.|+++++.++++. .|..|
T Consensus 60 ~~gh~~svdql~w~~~~~d~~atas~dk~ir~wd~r~~k~~~~i~~--~~eni~i~wsp~g~~~~~~~-------kdD~i 130 (313)
T KOG1407|consen 60 YRGHTDSVDQLCWDPKHPDLFATASGDKTIRIWDIRSGKCTARIET--KGENINITWSPDGEYIAVGN-------KDDRI 130 (313)
T ss_pred ccCCCcchhhheeCCCCCcceEEecCCceEEEEEeccCcEEEEeec--cCcceEEEEcCCCCEEEEec-------CcccE
Confidence 3678888999999974 45676655 57899999999988777664 45555668899999998877 67889
Q ss_pred EEEeCCCCcEEEEEeeCCceeEEEEeC--CeEEEEEC-CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeec
Q 020784 159 MIWDDHQSRCIGELSFRSEVRSVKLRR--DRIIVVLE-QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPG 235 (321)
Q Consensus 159 ~iWD~~~~~~~~~~~~~~~v~~v~~~~--~~~~~~~~-~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sG 235 (321)
...|.++.+.+.+.++...+..++|+. +.+++..+ |.|.|-.....+.+++++.|. ..++++..+|+|.++|+ |
T Consensus 131 t~id~r~~~~~~~~~~~~e~ne~~w~~~nd~Fflt~GlG~v~ILsypsLkpv~si~AH~--snCicI~f~p~GryfA~-G 207 (313)
T KOG1407|consen 131 TFIDARTYKIVNEEQFKFEVNEISWNNSNDLFFLTNGLGCVEILSYPSLKPVQSIKAHP--SNCICIEFDPDGRYFAT-G 207 (313)
T ss_pred EEEEecccceeehhcccceeeeeeecCCCCEEEEecCCceEEEEeccccccccccccCC--cceEEEEECCCCceEee-c
Confidence 999999999998888888888888864 34444444 799999999999999999875 67889999999999995 9
Q ss_pred CCCCcEEEEeeCCc-ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCce
Q 020784 236 LQKGQVRVEHYASK-RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAW 314 (321)
Q Consensus 236 s~dg~V~i~d~~~~-~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~ 314 (321)
+.|-.|-+||...- ++..+..|.=+|+.|.||.||++||+||+|.. |-|=+++||..+.+.........++.-+..-.
T Consensus 208 sADAlvSLWD~~ELiC~R~isRldwpVRTlSFS~dg~~lASaSEDh~-IDIA~vetGd~~~eI~~~~~t~tVAWHPk~~L 286 (313)
T KOG1407|consen 208 SADALVSLWDVDELICERCISRLDWPVRTLSFSHDGRMLASASEDHF-IDIAEVETGDRVWEIPCEGPTFTVAWHPKRPL 286 (313)
T ss_pred cccceeeccChhHhhhheeeccccCceEEEEeccCcceeeccCccce-EEeEecccCCeEEEeeccCCceeEEecCCCce
Confidence 99999999998753 46789999999999999999999999999998 99999999999998865444333343344444
Q ss_pred EEEe
Q 020784 315 LRVL 318 (321)
Q Consensus 315 la~~ 318 (321)
||.|
T Consensus 287 LAyA 290 (313)
T KOG1407|consen 287 LAYA 290 (313)
T ss_pred eeEE
Confidence 5554
No 61
>KOG0645 consensus WD40 repeat protein [General function prediction only]
Probab=99.88 E-value=1.2e-20 Score=159.03 Aligned_cols=198 Identities=16% Similarity=0.207 Sum_probs=151.5
Q ss_pred ccCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecC--CceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCC
Q 020784 80 TSSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDP--FREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLN 156 (321)
Q Consensus 80 ~~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~--~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~ 156 (321)
+.-.|...|++|+|+|.|++||+|+-|. +.||.-.. ++++..++. |+..|.+++|+.++++||+++ .|+
T Consensus 56 ld~~hkrsVRsvAwsp~g~~La~aSFD~t~~Iw~k~~~efecv~~lEG-HEnEVK~Vaws~sG~~LATCS-------RDK 127 (312)
T KOG0645|consen 56 LDDGHKRSVRSVAWSPHGRYLASASFDATVVIWKKEDGEFECVATLEG-HENEVKCVAWSASGNYLATCS-------RDK 127 (312)
T ss_pred ccccchheeeeeeecCCCcEEEEeeccceEEEeecCCCceeEEeeeec-cccceeEEEEcCCCCEEEEee-------CCC
Confidence 3446778999999999999999999866 66998754 345555555 788999999999999999999 789
Q ss_pred cEEEEeCCCCc---EEEEEeeC-CceeEEEEeC--CeEEEEE-CCEEEEEEcC---CcEEEEEEeccCCCCceEEEeeCC
Q 020784 157 KVMIWDDHQSR---CIGELSFR-SEVRSVKLRR--DRIIVVL-EQKIFVYNFA---DLKLLHQIETIANPKGLCAVSQGV 226 (321)
Q Consensus 157 ~v~iWD~~~~~---~~~~~~~~-~~v~~v~~~~--~~~~~~~-~~~I~iwd~~---~~~~~~~l~~~~~~~~~~~~s~~~ 226 (321)
.|-||....+. +..-++.+ ..|..+.||| +.++.++ |++||+|.-. ..+++++|.+|.+. +.++.+++
T Consensus 128 SVWiWe~deddEfec~aVL~~HtqDVK~V~WHPt~dlL~S~SYDnTIk~~~~~~dddW~c~~tl~g~~~T--VW~~~F~~ 205 (312)
T KOG0645|consen 128 SVWIWEIDEDDEFECIAVLQEHTQDVKHVIWHPTEDLLFSCSYDNTIKVYRDEDDDDWECVQTLDGHENT--VWSLAFDN 205 (312)
T ss_pred eEEEEEecCCCcEEEEeeeccccccccEEEEcCCcceeEEeccCCeEEEEeecCCCCeeEEEEecCccce--EEEEEecC
Confidence 99999987543 55555544 4799999999 5566664 7899999875 56889999998764 45555555
Q ss_pred CceEEEeecCCCCcEEEEeeCC-------c-------------------ceE------------------Eeecccccee
Q 020784 227 GSLVLVCPGLQKGQVRVEHYAS-------K-------------------RTK------------------FIMAHDSRIA 262 (321)
Q Consensus 227 d~~~la~sGs~dg~V~i~d~~~-------~-------------------~~~------------------~l~~H~~~V~ 262 (321)
.|..|+ +++.|++|+||.... + .+. .-.+|...|+
T Consensus 206 ~G~rl~-s~sdD~tv~Iw~~~~~~~~~~sr~~Y~v~W~~~~IaS~ggD~~i~lf~~s~~~d~p~~~l~~~~~~aHe~dVN 284 (312)
T KOG0645|consen 206 IGSRLV-SCSDDGTVSIWRLYTDLSGMHSRALYDVPWDNGVIASGGGDDAIRLFKESDSPDEPSWNLLAKKEGAHEVDVN 284 (312)
T ss_pred CCceEE-EecCCcceEeeeeccCcchhcccceEeeeecccceEeccCCCEEEEEEecCCCCCchHHHHHhhhcccccccc
Confidence 556777 589999999987210 0 000 1135778899
Q ss_pred EEEECCC-CCEEEEEeCCCcEEEEEEcC
Q 020784 263 CFALTQD-GQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 263 ~vafspd-g~~las~S~Dgt~IrIWd~~ 289 (321)
+|.|+|. ..+|++||.||. |++|.+.
T Consensus 285 sV~w~p~~~~~L~s~~DDG~-v~~W~l~ 311 (312)
T KOG0645|consen 285 SVQWNPKVSNRLASGGDDGI-VNFWELE 311 (312)
T ss_pred eEEEcCCCCCceeecCCCce-EEEEEec
Confidence 9999995 678999999998 9999875
No 62
>KOG0281 consensus Beta-TrCP (transducin repeats containing)/Slimb proteins [Function unknown]
Probab=99.88 E-value=2.5e-23 Score=180.53 Aligned_cols=207 Identities=13% Similarity=0.229 Sum_probs=158.9
Q ss_pred CCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC
Q 020784 86 PTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH 164 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~ 164 (321)
..|+|+.+. ...+++|.. ++|+|||..+..+...... |.|.|-++.+ +...+ ++|+ +|.+|+|||++
T Consensus 198 kgVYClQYD--D~kiVSGlrDnTikiWD~n~~~c~~~L~G-HtGSVLCLqy--d~rvi--isGS-----SDsTvrvWDv~ 265 (499)
T KOG0281|consen 198 KGVYCLQYD--DEKIVSGLRDNTIKIWDKNSLECLKILTG-HTGSVLCLQY--DERVI--VSGS-----SDSTVRVWDVN 265 (499)
T ss_pred CceEEEEec--chhhhcccccCceEEeccccHHHHHhhhc-CCCcEEeeec--cceEE--EecC-----CCceEEEEecc
Confidence 379999875 456788886 6799999998877666554 6666666554 44433 3433 68999999999
Q ss_pred CCcEEEEEeeC-CceeEEEEeCCeEEEEEC-CEEEEEEcCCc---EEEEEEeccCCCCceEEEeeCCCceEEEeecCCCC
Q 020784 165 QSRCIGELSFR-SEVRSVKLRRDRIIVVLE-QKIFVYNFADL---KLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKG 239 (321)
Q Consensus 165 ~~~~~~~~~~~-~~v~~v~~~~~~~~~~~~-~~I~iwd~~~~---~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg 239 (321)
+|+++.++-++ ..|..+.|+...++.++. .+|++||+... .+.+.+.+|...+.++.|.. .+++ +++.|.
T Consensus 266 tge~l~tlihHceaVLhlrf~ng~mvtcSkDrsiaVWdm~sps~it~rrVLvGHrAaVNvVdfd~----kyIV-sASgDR 340 (499)
T KOG0281|consen 266 TGEPLNTLIHHCEAVLHLRFSNGYMVTCSKDRSIAVWDMASPTDITLRRVLVGHRAAVNVVDFDD----KYIV-SASGDR 340 (499)
T ss_pred CCchhhHHhhhcceeEEEEEeCCEEEEecCCceeEEEeccCchHHHHHHHHhhhhhheeeecccc----ceEE-EecCCc
Confidence 99999887655 579999999998888874 59999999643 33445667777666666543 5776 689999
Q ss_pred cEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCc
Q 020784 240 QVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSA 313 (321)
Q Consensus 240 ~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~ 313 (321)
+|++|+..+.. +.++.+|+..|-|+-+ .|+++++||.|.+ ||+||+..|+|++-+ .||...+.++-||.+
T Consensus 341 TikvW~~st~efvRtl~gHkRGIAClQY--r~rlvVSGSSDnt-IRlwdi~~G~cLRvL-eGHEeLvRciRFd~k 411 (499)
T KOG0281|consen 341 TIKVWSTSTCEFVRTLNGHKRGIACLQY--RDRLVVSGSSDNT-IRLWDIECGACLRVL-EGHEELVRCIRFDNK 411 (499)
T ss_pred eEEEEeccceeeehhhhcccccceehhc--cCeEEEecCCCce-EEEEeccccHHHHHH-hchHHhhhheeecCc
Confidence 99999998765 6699999999999877 5899999999999 999999999998877 577655444444443
No 63
>KOG0285 consensus Pleiotropic regulator 1 [RNA processing and modification]
Probab=99.88 E-value=8.8e-22 Score=171.44 Aligned_cols=175 Identities=15% Similarity=0.164 Sum_probs=145.6
Q ss_pred cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeC-CceeEEEEeCCe--EEEEE-CCEEEEEEc
Q 020784 126 RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFR-SEVRSVKLRRDR--IIVVL-EQKIFVYNF 201 (321)
Q Consensus 126 ~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~-~~v~~v~~~~~~--~~~~~-~~~I~iwd~ 201 (321)
|.+.|.++++.+....+++.+ .|++++|||+.+|++..++..+ ..|..|.+++.. ++.+. +++|+.||+
T Consensus 150 HlgWVr~vavdP~n~wf~tgs-------~DrtikIwDlatg~LkltltGhi~~vr~vavS~rHpYlFs~gedk~VKCwDL 222 (460)
T KOG0285|consen 150 HLGWVRSVAVDPGNEWFATGS-------ADRTIKIWDLATGQLKLTLTGHIETVRGVAVSKRHPYLFSAGEDKQVKCWDL 222 (460)
T ss_pred ccceEEEEeeCCCceeEEecC-------CCceeEEEEcccCeEEEeecchhheeeeeeecccCceEEEecCCCeeEEEec
Confidence 788999999988866666655 6899999999999999888854 578899998653 44454 579999999
Q ss_pred CCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCC
Q 020784 202 ADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKG 280 (321)
Q Consensus 202 ~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dg 280 (321)
...+.++.+.+|...+.++++.|.- ..|+ +|+.|.+++|||+.++. +.++.+|+.+|.+|.+.|-...++|||.|+
T Consensus 223 e~nkvIR~YhGHlS~V~~L~lhPTl--dvl~-t~grDst~RvWDiRtr~~V~~l~GH~~~V~~V~~~~~dpqvit~S~D~ 299 (460)
T KOG0285|consen 223 EYNKVIRHYHGHLSGVYCLDLHPTL--DVLV-TGGRDSTIRVWDIRTRASVHVLSGHTNPVASVMCQPTDPQVITGSHDS 299 (460)
T ss_pred hhhhhHHHhccccceeEEEeccccc--eeEE-ecCCcceEEEeeecccceEEEecCCCCcceeEEeecCCCceEEecCCc
Confidence 9999999999998877777777654 5566 59999999999999876 779999999999999999888899999999
Q ss_pred cEEEEEEcCCCcEEEEEeCCCcceeEEEeecC
Q 020784 281 TLVRIFNTLDGTLLQEECCPSISAQSGLWLSS 312 (321)
Q Consensus 281 t~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~ 312 (321)
+ ||+||++.|+-..++ ..|.....++...+
T Consensus 300 t-vrlWDl~agkt~~tl-t~hkksvral~lhP 329 (460)
T KOG0285|consen 300 T-VRLWDLRAGKTMITL-THHKKSVRALCLHP 329 (460)
T ss_pred e-EEEeeeccCceeEee-ecccceeeEEecCC
Confidence 9 999999999988887 35665555555444
No 64
>KOG0292 consensus Vesicle coat complex COPI, alpha subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.88 E-value=7.8e-22 Score=188.19 Aligned_cols=215 Identities=15% Similarity=0.183 Sum_probs=171.0
Q ss_pred CCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeC
Q 020784 85 PPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDD 163 (321)
Q Consensus 85 ~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~ 163 (321)
.++|..++|+|..-++.++-..| |++||..=+..+....- |+|+|+.+++++...+++.++ +|.+||||+.
T Consensus 9 SsRvKglsFHP~rPwILtslHsG~IQlWDYRM~tli~rFde-HdGpVRgv~FH~~qplFVSGG-------DDykIkVWnY 80 (1202)
T KOG0292|consen 9 SSRVKGLSFHPKRPWILTSLHSGVIQLWDYRMGTLIDRFDE-HDGPVRGVDFHPTQPLFVSGG-------DDYKIKVWNY 80 (1202)
T ss_pred cccccceecCCCCCEEEEeecCceeeeehhhhhhHHhhhhc-cCCccceeeecCCCCeEEecC-------CccEEEEEec
Confidence 35899999999999999999866 66999765554444433 799999999999888765544 6799999999
Q ss_pred CCCcEEEEEeeC-CceeEEEEeCCe--EEEEEC-CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCC
Q 020784 164 HQSRCIGELSFR-SEVRSVKLRRDR--IIVVLE-QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKG 239 (321)
Q Consensus 164 ~~~~~~~~~~~~-~~v~~v~~~~~~--~~~~~~-~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg 239 (321)
++.+|+.++..| ..|..+.||+.. ++.++| .+|||||..+.+++..+.+|.+.+.+..|++. ..+++ |+|-|.
T Consensus 81 k~rrclftL~GHlDYVRt~~FHheyPWIlSASDDQTIrIWNwqsr~~iavltGHnHYVMcAqFhpt--EDlIV-SaSLDQ 157 (1202)
T KOG0292|consen 81 KTRRCLFTLLGHLDYVRTVFFHHEYPWILSASDDQTIRIWNWQSRKCIAVLTGHNHYVMCAQFHPT--EDLIV-SASLDQ 157 (1202)
T ss_pred ccceehhhhccccceeEEeeccCCCceEEEccCCCeEEEEeccCCceEEEEecCceEEEeeccCCc--cceEE-Eecccc
Confidence 999999888766 479999999875 555665 59999999999999999999876555555553 35666 799999
Q ss_pred cEEEEeeCC----------------------------cc-e-EEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcC
Q 020784 240 QVRVEHYAS----------------------------KR-T-KFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 240 ~V~i~d~~~----------------------------~~-~-~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~ 289 (321)
+|||||... .. + .++.||++.|+-++|+|.-.+++||++|+- ||+|.+.
T Consensus 158 TVRVWDisGLRkk~~~pg~~e~~~~~~~~~~dLfg~~DaVVK~VLEGHDRGVNwaAfhpTlpliVSG~DDRq-VKlWrmn 236 (1202)
T KOG0292|consen 158 TVRVWDISGLRKKNKAPGSLEDQMRGQQGNSDLFGQTDAVVKHVLEGHDRGVNWAAFHPTLPLIVSGADDRQ-VKLWRMN 236 (1202)
T ss_pred eEEEEeecchhccCCCCCCchhhhhccccchhhcCCcCeeeeeeecccccccceEEecCCcceEEecCCcce-eeEEEec
Confidence 999999641 01 1 267899999999999999999999999988 9999998
Q ss_pred CCcEE--EEEeCCCcceeEEEeecC
Q 020784 290 DGTLL--QEECCPSISAQSGLWLSS 312 (321)
Q Consensus 290 tg~~i--~~~~~g~~~~~~~~s~d~ 312 (321)
.-+.. .++ +||.+...++-|.+
T Consensus 237 etKaWEvDtc-rgH~nnVssvlfhp 260 (1202)
T KOG0292|consen 237 ETKAWEVDTC-RGHYNNVSSVLFHP 260 (1202)
T ss_pred cccceeehhh-hcccCCcceEEecC
Confidence 76643 344 67777666666655
No 65
>KOG0318 consensus WD40 repeat stress protein/actin interacting protein [Cytoskeleton]
Probab=99.88 E-value=2.2e-20 Score=169.70 Aligned_cols=224 Identities=17% Similarity=0.165 Sum_probs=177.9
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeee--cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFE--RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~--~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
+.|..-|+|++|+|||.+||+.+. +.+.|||=.+++.+...+-. |.+.|..+.|+|++..+++++ .|+++
T Consensus 187 r~HskFV~~VRysPDG~~Fat~gsDgki~iyDGktge~vg~l~~~~aHkGsIfalsWsPDs~~~~T~S-------aDkt~ 259 (603)
T KOG0318|consen 187 REHSKFVNCVRYSPDGSRFATAGSDGKIYIYDGKTGEKVGELEDSDAHKGSIFALSWSPDSTQFLTVS-------ADKTI 259 (603)
T ss_pred cccccceeeEEECCCCCeEEEecCCccEEEEcCCCccEEEEecCCCCccccEEEEEECCCCceEEEec-------CCceE
Confidence 567779999999999999997766 55889999998887766621 789999999999999999999 67999
Q ss_pred EEEeCCCCcEEEEEeeCCce----eEEEEeCCeEEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEe
Q 020784 159 MIWDDHQSRCIGELSFRSEV----RSVKLRRDRIIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVC 233 (321)
Q Consensus 159 ~iWD~~~~~~~~~~~~~~~v----~~v~~~~~~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~ 233 (321)
||||+.+.+++.++.....| ..+-|..+.++.. .++.|.+++......++.+.+|...+.++.++++ +.+|.
T Consensus 260 KIWdVs~~slv~t~~~~~~v~dqqvG~lWqkd~lItVSl~G~in~ln~~d~~~~~~i~GHnK~ITaLtv~~d--~~~i~- 336 (603)
T KOG0318|consen 260 KIWDVSTNSLVSTWPMGSTVEDQQVGCLWQKDHLITVSLSGTINYLNPSDPSVLKVISGHNKSITALTVSPD--GKTIY- 336 (603)
T ss_pred EEEEeeccceEEEeecCCchhceEEEEEEeCCeEEEEEcCcEEEEecccCCChhheecccccceeEEEEcCC--CCEEE-
Confidence 99999999999998876543 3344566666555 5789999999999999999999887766666664 46776
Q ss_pred ecCCCCcEEEEeeCCcceEEe--eccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEE--EeCCCcceeEEEe
Q 020784 234 PGLQKGQVRVEHYASKRTKFI--MAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQE--ECCPSISAQSGLW 309 (321)
Q Consensus 234 sGs~dg~V~i~d~~~~~~~~l--~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~--~~~g~~~~~~~~s 309 (321)
+|+.||.|.-|+...+..-.+ +.|...|.+++-+..+. +.|+|+|.+ +|+.++..+..-.. ++.+++...++..
T Consensus 337 SgsyDG~I~~W~~~~g~~~~~~g~~h~nqI~~~~~~~~~~-~~t~g~Dd~-l~~~~~~~~~~t~~~~~~lg~QP~~lav~ 414 (603)
T KOG0318|consen 337 SGSYDGHINSWDSGSGTSDRLAGKGHTNQIKGMAASESGE-LFTIGWDDT-LRVISLKDNGYTKSEVVKLGSQPKGLAVL 414 (603)
T ss_pred eeccCceEEEEecCCccccccccccccceEEEEeecCCCc-EEEEecCCe-EEEEecccCcccccceeecCCCceeEEEc
Confidence 799999999999887665544 78999999999987776 568889999 99999865433222 3567777777766
Q ss_pred ecCceEEE
Q 020784 310 LSSAWLRV 317 (321)
Q Consensus 310 ~d~~~la~ 317 (321)
.++.++.+
T Consensus 415 ~d~~~avv 422 (603)
T KOG0318|consen 415 SDGGTAVV 422 (603)
T ss_pred CCCCEEEE
Confidence 66655444
No 66
>KOG0319 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.88 E-value=1.7e-21 Score=182.99 Aligned_cols=199 Identities=12% Similarity=0.184 Sum_probs=164.2
Q ss_pred cCCCCCCeEEEEEcCCC-CEEEEEcCCc-EEEEEecCCcee---EEee-----eecCCceEEEEEecCCCeEEEEeCCCC
Q 020784 81 SSSPPPTLLHISFNQDH-GCFAAGTDHG-FRIYNCDPFREI---FRRD-----FERGGGIGVVEMLFRCNILALVGGGPD 150 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg-~~lasg~~~g-v~vw~~~~~~~~---~~~~-----~~~~~~v~~v~~~~~~~~~~~~sg~~~ 150 (321)
..+|.+.|.+|+++-.| .+|++++.|. +++|++...+.. .... ..|+..|++|++.++..++|+++
T Consensus 407 ~~gH~~svgava~~~~~asffvsvS~D~tlK~W~l~~s~~~~~~~~~~~~~t~~aHdKdIN~Vaia~ndkLiAT~S---- 482 (775)
T KOG0319|consen 407 ANGHTNSVGAVAGSKLGASFFVSVSQDCTLKLWDLPKSKETAFPIVLTCRYTERAHDKDINCVAIAPNDKLIATGS---- 482 (775)
T ss_pred hcccccccceeeecccCccEEEEecCCceEEEecCCCcccccccceehhhHHHHhhcccccceEecCCCceEEecc----
Confidence 36788999999998766 5888888755 889998652210 1110 01899999999999999999988
Q ss_pred CCCCCCcEEEEeCCCCcEEEEEeeCC-ceeEEEEeCC--eEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCC
Q 020784 151 PQYPLNKVMIWDDHQSRCIGELSFRS-EVRSVKLRRD--RIIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGV 226 (321)
Q Consensus 151 ~~~~d~~v~iWD~~~~~~~~~~~~~~-~v~~v~~~~~--~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~ 226 (321)
.|++.|||++........+..|. .|.+|.|.+. .++.++ |.+|+||.+.++.++++|.+|...+.-+.|-.++
T Consensus 483 ---qDktaKiW~le~~~l~~vLsGH~RGvw~V~Fs~~dq~laT~SgD~TvKIW~is~fSClkT~eGH~~aVlra~F~~~~ 559 (775)
T KOG0319|consen 483 ---QDKTAKIWDLEQLRLLGVLSGHTRGVWCVSFSKNDQLLATCSGDKTVKIWSISTFSCLKTFEGHTSAVLRASFIRNG 559 (775)
T ss_pred ---cccceeeecccCceEEEEeeCCccceEEEEeccccceeEeccCCceEEEEEeccceeeeeecCccceeEeeeeeeCC
Confidence 88999999999888888888775 7999999986 444444 4699999999999999999998887777776654
Q ss_pred CceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 227 GSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 227 d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
..|+ |++.||.+++|+.+++. +.++.+|+..|++++-++++.+++||+.||. |.+|.=-|
T Consensus 560 --~qli-S~~adGliKlWnikt~eC~~tlD~H~DrvWaL~~~~~~~~~~tgg~Dg~-i~~wkD~T 620 (775)
T KOG0319|consen 560 --KQLI-SAGADGLIKLWNIKTNECEMTLDAHNDRVWALSVSPLLDMFVTGGGDGR-IIFWKDVT 620 (775)
T ss_pred --cEEE-eccCCCcEEEEeccchhhhhhhhhccceeEEEeecCccceeEecCCCeE-EEEeecCc
Confidence 5565 68999999999998765 7899999999999999999999999999999 88995443
No 67
>KOG0283 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.88 E-value=3.7e-21 Score=183.27 Aligned_cols=224 Identities=16% Similarity=0.179 Sum_probs=156.3
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecC----------------------------Cce--eEE---------
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDP----------------------------FRE--IFR--------- 121 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~----------------------------~~~--~~~--------- 121 (321)
..|.+.|.++.||+||+|||+|+.|+ ||||.+.. ... +..
T Consensus 264 ~ah~gaIw~mKFS~DGKyLAsaGeD~virVWkVie~e~~~~~~~~~~~~~~~~~~~s~~~p~~s~~~~~~~~~s~~~~~~ 343 (712)
T KOG0283|consen 264 NAHKGAIWAMKFSHDGKYLASAGEDGVIRVWKVIESERMRVAEGDSSCMYFEYNANSQIEPSTSSEEKISSRTSSSRKGS 343 (712)
T ss_pred cccCCcEEEEEeCCCCceeeecCCCceEEEEEEeccchhcccccccchhhhhhhhccccCcccccccccccccccccccc
Confidence 47889999999999999999999988 56997643 000 000
Q ss_pred -------------------eeee-cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEE
Q 020784 122 -------------------RDFE-RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSV 181 (321)
Q Consensus 122 -------------------~~~~-~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v 181 (321)
.++. |.+.|-.+.|+.+ +.|+.++ .|+|||+|++...+|+..|.|..-|+||
T Consensus 344 ~s~~~~~p~~~f~f~ekP~~ef~GHt~DILDlSWSKn-~fLLSSS-------MDKTVRLWh~~~~~CL~~F~HndfVTcV 415 (712)
T KOG0283|consen 344 QSPCVLLPLKAFVFSEKPFCEFKGHTADILDLSWSKN-NFLLSSS-------MDKTVRLWHPGRKECLKVFSHNDFVTCV 415 (712)
T ss_pred CCccccCCCccccccccchhhhhccchhheecccccC-CeeEecc-------ccccEEeecCCCcceeeEEecCCeeEEE
Confidence 0000 3344444444332 2344444 7999999999999999999999999999
Q ss_pred EEeCC---eEEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceE---Ee
Q 020784 182 KLRRD---RIIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTK---FI 254 (321)
Q Consensus 182 ~~~~~---~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~---~l 254 (321)
+|+|. .++.+ .|++||||++...+.+.-.+.+ ..+..+++. |||+..++ |+.+|.+++|+...-++. .+
T Consensus 416 aFnPvDDryFiSGSLD~KvRiWsI~d~~Vv~W~Dl~-~lITAvcy~--PdGk~avI-Gt~~G~C~fY~t~~lk~~~~~~I 491 (712)
T KOG0283|consen 416 AFNPVDDRYFISGSLDGKVRLWSISDKKVVDWNDLR-DLITAVCYS--PDGKGAVI-GTFNGYCRFYDTEGLKLVSDFHI 491 (712)
T ss_pred EecccCCCcEeecccccceEEeecCcCeeEeehhhh-hhheeEEec--cCCceEEE-EEeccEEEEEEccCCeEEEeeeE
Confidence 99983 34443 5789999999887766554444 333444454 45677665 999999999987654433 11
Q ss_pred e-------ccccceeEEEECCCCC-EEEEEeCCCcEEEEEEcCCCcEEEEEeCC---CcceeEEEeecCceEEEee
Q 020784 255 M-------AHDSRIACFALTQDGQ-LLATSSTKGTLVRIFNTLDGTLLQEECCP---SISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 255 ~-------~H~~~V~~vafspdg~-~las~S~Dgt~IrIWd~~tg~~i~~~~~g---~~~~~~~~s~d~~~la~~~ 319 (321)
. .|. .|+.+-|.|... .++..|.|.. |||+|.++-+++..|+.- +.....+|+.||+||..++
T Consensus 492 ~~~~~Kk~~~~-rITG~Q~~p~~~~~vLVTSnDSr-IRI~d~~~~~lv~KfKG~~n~~SQ~~Asfs~Dgk~IVs~s 565 (712)
T KOG0283|consen 492 RLHNKKKKQGK-RITGLQFFPGDPDEVLVTSNDSR-IRIYDGRDKDLVHKFKGFRNTSSQISASFSSDGKHIVSAS 565 (712)
T ss_pred eeccCccccCc-eeeeeEecCCCCCeEEEecCCCc-eEEEeccchhhhhhhcccccCCcceeeeEccCCCEEEEee
Confidence 1 233 799999986533 3555667988 999999988888877522 2223348888999987654
No 68
>KOG0641 consensus WD40 repeat protein [General function prediction only]
Probab=99.88 E-value=1.1e-19 Score=149.84 Aligned_cols=206 Identities=14% Similarity=0.171 Sum_probs=157.2
Q ss_pred CCCcccCCCCCCeEEEEEcCCCCEEEEEcC-CcEEEE--EecCC---ceeEEeeeecCCceEEEEEecC----CCeEEEE
Q 020784 76 PAESTSSSPPPTLLHISFNQDHGCFAAGTD-HGFRIY--NCDPF---REIFRRDFERGGGIGVVEMLFR----CNILALV 145 (321)
Q Consensus 76 ~~~~~~~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw--~~~~~---~~~~~~~~~~~~~v~~v~~~~~----~~~~~~~ 145 (321)
+.......|++.|+|++|+|+|++||+|++ +.|++. |.++. +......+ |++.|..+++.-+ +.+++.+
T Consensus 80 v~~kr~khhkgsiyc~~ws~~geliatgsndk~ik~l~fn~dt~~~~g~dle~nm-hdgtirdl~fld~~~s~~~il~s~ 158 (350)
T KOG0641|consen 80 VLCKRNKHHKGSIYCTAWSPCGELIATGSNDKTIKVLPFNADTCNATGHDLEFNM-HDGTIRDLAFLDDPESGGAILASA 158 (350)
T ss_pred EEeeeccccCccEEEEEecCccCeEEecCCCceEEEEecccccccccCcceeeee-cCCceeeeEEecCCCcCceEEEec
Confidence 334445678899999999999999999998 457655 33332 22223344 7899999888643 2344444
Q ss_pred eCCCCCCCCCCcEEEEeCCCCcEEEEEeeC-CceeEEE-EeCCeEEEEE-CCEEEEEEcCCcEEEEEEeccCCC-----C
Q 020784 146 GGGPDPQYPLNKVMIWDDHQSRCIGELSFR-SEVRSVK-LRRDRIIVVL-EQKIFVYNFADLKLLHQIETIANP-----K 217 (321)
Q Consensus 146 sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~-~~v~~v~-~~~~~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~-----~ 217 (321)
+.| |-+|.+-|..+|+....+..+ +.|.++. |+.-.++.++ +++||+||++-..++.++...... .
T Consensus 159 gag------dc~iy~tdc~~g~~~~a~sghtghilalyswn~~m~~sgsqdktirfwdlrv~~~v~~l~~~~~~~gless 232 (350)
T KOG0641|consen 159 GAG------DCKIYITDCGRGQGFHALSGHTGHILALYSWNGAMFASGSQDKTIRFWDLRVNSCVNTLDNDFHDGGLESS 232 (350)
T ss_pred CCC------cceEEEeecCCCCcceeecCCcccEEEEEEecCcEEEccCCCceEEEEeeeccceeeeccCcccCCCcccc
Confidence 443 456888899999877777655 5788865 5655555554 469999999988888888653322 3
Q ss_pred ceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 218 GLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 218 ~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
.+.+++.+|.+.+|+ +|..|....++|+..+. +..+..|...|+||.|||...||.|||.|.. ||+=|++-
T Consensus 233 avaav~vdpsgrll~-sg~~dssc~lydirg~r~iq~f~phsadir~vrfsp~a~yllt~syd~~-ikltdlqg 304 (350)
T KOG0641|consen 233 AVAAVAVDPSGRLLA-SGHADSSCMLYDIRGGRMIQRFHPHSADIRCVRFSPGAHYLLTCSYDMK-IKLTDLQG 304 (350)
T ss_pred eeEEEEECCCcceee-eccCCCceEEEEeeCCceeeeeCCCccceeEEEeCCCceEEEEecccce-EEEeeccc
Confidence 456778888889999 69999999999998765 6689999999999999999999999999999 99999873
No 69
>KOG0640 consensus mRNA cleavage stimulating factor complex; subunit 1 [RNA processing and modification]
Probab=99.88 E-value=5e-21 Score=164.08 Aligned_cols=209 Identities=16% Similarity=0.244 Sum_probs=158.8
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCC------------c----eeEEeee-ecCCceEEEEEecCCCeEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPF------------R----EIFRRDF-ERGGGIGVVEMLFRCNILA 143 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~------------~----~~~~~~~-~~~~~v~~v~~~~~~~~~~ 143 (321)
..|.+++++.+|++||.++|+|+.|. |+|.|++.+ + .-..+.+ +|...|..+++++...+++
T Consensus 109 t~HK~~cR~aafs~DG~lvATGsaD~SIKildvermlaks~~~em~~~~~qa~hPvIRTlYDH~devn~l~FHPre~ILi 188 (430)
T KOG0640|consen 109 TSHKSPCRAAAFSPDGSLVATGSADASIKILDVERMLAKSKPKEMISGDTQARHPVIRTLYDHVDEVNDLDFHPRETILI 188 (430)
T ss_pred eecccceeeeeeCCCCcEEEccCCcceEEEeehhhhhhhcchhhhccCCcccCCceEeehhhccCcccceeecchhheEE
Confidence 56888999999999999999999866 889998621 0 0111222 2677888989888777776
Q ss_pred EEeCCCCCCCCCCcEEEEeCCCCcE---EEEEeeCCceeEEEEeCC--eEEEEECC-EEEEEEcCCcEEEEEEec-cCCC
Q 020784 144 LVGGGPDPQYPLNKVMIWDDHQSRC---IGELSFRSEVRSVKLRRD--RIIVVLEQ-KIFVYNFADLKLLHQIET-IANP 216 (321)
Q Consensus 144 ~~sg~~~~~~~d~~v~iWD~~~~~~---~~~~~~~~~v~~v~~~~~--~~~~~~~~-~I~iwd~~~~~~~~~l~~-~~~~ 216 (321)
..+ .|++||++|..+... ...|+....|.++.|||. +++++++. .+|+||+.+.++...-.. ....
T Consensus 189 S~s-------rD~tvKlFDfsK~saKrA~K~~qd~~~vrsiSfHPsGefllvgTdHp~~rlYdv~T~QcfvsanPd~qht 261 (430)
T KOG0640|consen 189 SGS-------RDNTVKLFDFSKTSAKRAFKVFQDTEPVRSISFHPSGEFLLVGTDHPTLRLYDVNTYQCFVSANPDDQHT 261 (430)
T ss_pred ecc-------CCCeEEEEecccHHHHHHHHHhhccceeeeEeecCCCceEEEecCCCceeEEeccceeEeeecCcccccc
Confidence 655 789999999876433 233444568999999974 57777774 999999999887654321 1223
Q ss_pred CceEEEeeCCCceEEEeecCCCCcEEEEeeCC-cceEEe-ecccc-ceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcE
Q 020784 217 KGLCAVSQGVGSLVLVCPGLQKGQVRVEHYAS-KRTKFI-MAHDS-RIACFALTQDGQLLATSSTKGTLVRIFNTLDGTL 293 (321)
Q Consensus 217 ~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~-~~~~~l-~~H~~-~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~ 293 (321)
..++.+..++.+.+.+ +|+.||.|+|||--. +++.++ ++|.+ .|.+..|..||+|+.|.+.|.+ |++|.+.+|.+
T Consensus 262 ~ai~~V~Ys~t~~lYv-TaSkDG~IklwDGVS~rCv~t~~~AH~gsevcSa~Ftkn~kyiLsSG~DS~-vkLWEi~t~R~ 339 (430)
T KOG0640|consen 262 GAITQVRYSSTGSLYV-TASKDGAIKLWDGVSNRCVRTIGNAHGGSEVCSAVFTKNGKYILSSGKDST-VKLWEISTGRM 339 (430)
T ss_pred cceeEEEecCCccEEE-EeccCCcEEeeccccHHHHHHHHhhcCCceeeeEEEccCCeEEeecCCcce-eeeeeecCCce
Confidence 3466666666778777 599999999999544 455555 46754 6999999999999999999999 99999999999
Q ss_pred EEEEeC
Q 020784 294 LQEECC 299 (321)
Q Consensus 294 i~~~~~ 299 (321)
+.+|..
T Consensus 340 l~~YtG 345 (430)
T KOG0640|consen 340 LKEYTG 345 (430)
T ss_pred EEEEec
Confidence 999853
No 70
>KOG0277 consensus Peroxisomal targeting signal type 2 receptor [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.88 E-value=1.8e-21 Score=162.65 Aligned_cols=227 Identities=15% Similarity=0.146 Sum_probs=162.9
Q ss_pred cccCCCCCCeEEEEEcCCC--CEEEEEcCCcEEEEEecCC-ceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCC
Q 020784 79 STSSSPPPTLLHISFNQDH--GCFAAGTDHGFRIYNCDPF-REIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPL 155 (321)
Q Consensus 79 ~~~~~~~~~V~~v~fs~dg--~~lasg~~~gv~vw~~~~~-~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d 155 (321)
..+..-...+..|+|+++- ..+++.+|+.++|||+... +.+...+- |...|..+.+....+...+.+ + -|
T Consensus 54 ~~s~d~~D~LfdV~Wse~~e~~~~~a~GDGSLrl~d~~~~s~Pi~~~kE-H~~EV~Svdwn~~~r~~~lts-S-----WD 126 (311)
T KOG0277|consen 54 CQSYDTEDGLFDVAWSENHENQVIAASGDGSLRLFDLTMPSKPIHKFKE-HKREVYSVDWNTVRRRIFLTS-S-----WD 126 (311)
T ss_pred EEeeecccceeEeeecCCCcceEEEEecCceEEEeccCCCCcchhHHHh-hhhheEEeccccccceeEEee-c-----cC
Confidence 3344555689999999864 4455556667999995332 22222221 677888888876544444444 2 57
Q ss_pred CcEEEEeCCCCcEEEEEeeCC-ceeEEEEeCC---eEEEE-ECCEEEEEEcCC-cEEEEEEeccCCCCceEEEeeCCCce
Q 020784 156 NKVMIWDDHQSRCIGELSFRS-EVRSVKLRRD---RIIVV-LEQKIFVYNFAD-LKLLHQIETIANPKGLCAVSQGVGSL 229 (321)
Q Consensus 156 ~~v~iWD~~~~~~~~~~~~~~-~v~~v~~~~~---~~~~~-~~~~I~iwd~~~-~~~~~~l~~~~~~~~~~~~s~~~d~~ 229 (321)
++||+||...++-+.++..+. -|+...|++. .++.+ +++++++||++. ++.+ .|..|...+.+|.++.- +..
T Consensus 127 ~TiKLW~~~r~~Sv~Tf~gh~~~Iy~a~~sp~~~nlfas~Sgd~~l~lwdvr~~gk~~-~i~ah~~Eil~cdw~ky-~~~ 204 (311)
T KOG0277|consen 127 GTIKLWDPNRPNSVQTFNGHNSCIYQAAFSPHIPNLFASASGDGTLRLWDVRSPGKFM-SIEAHNSEILCCDWSKY-NHN 204 (311)
T ss_pred CceEeecCCCCcceEeecCCccEEEEEecCCCCCCeEEEccCCceEEEEEecCCCcee-EEEeccceeEeeccccc-CCc
Confidence 999999999999999988765 6899999874 45555 457999999965 4444 48888877888888764 446
Q ss_pred EEEeecCCCCcEEEEeeCCc--ceEEeeccccceeEEEECCC-CCEEEEEeCCCcEEEEEEcCCCc-EEEEEeCCCccee
Q 020784 230 VLVCPGLQKGQVRVEHYASK--RTKFIMAHDSRIACFALTQD-GQLLATSSTKGTLVRIFNTLDGT-LLQEECCPSISAQ 305 (321)
Q Consensus 230 ~la~sGs~dg~V~i~d~~~~--~~~~l~~H~~~V~~vafspd-g~~las~S~Dgt~IrIWd~~tg~-~i~~~~~g~~~~~ 305 (321)
+++ +|+.|+.|++||+..- ++.++.+|.-+|+.|+|||. ..+|||+|.|-| +||||...+. ++.+++ -|....
T Consensus 205 vl~-Tg~vd~~vr~wDir~~r~pl~eL~gh~~AVRkvk~Sph~~~lLaSasYDmT-~riw~~~~~ds~~e~~~-~HtEFv 281 (311)
T KOG0277|consen 205 VLA-TGGVDNLVRGWDIRNLRTPLFELNGHGLAVRKVKFSPHHASLLASASYDMT-VRIWDPERQDSAIETVD-HHTEFV 281 (311)
T ss_pred EEE-ecCCCceEEEEehhhccccceeecCCceEEEEEecCcchhhHhhhccccce-EEecccccchhhhhhhh-ccceEE
Confidence 666 6999999999998753 46789999999999999987 568999999999 9999998654 444443 344443
Q ss_pred EEE--e-ecCceEEE
Q 020784 306 SGL--W-LSSAWLRV 317 (321)
Q Consensus 306 ~~~--s-~d~~~la~ 317 (321)
..+ + +++.|+|-
T Consensus 282 ~g~Dws~~~~~~vAs 296 (311)
T KOG0277|consen 282 CGLDWSLFDPGQVAS 296 (311)
T ss_pred eccccccccCceeee
Confidence 322 2 45666654
No 71
>KOG4283 consensus Transcription-coupled repair protein CSA, contains WD40 domain [Transcription; Replication, recombination and repair]
Probab=99.87 E-value=1.4e-20 Score=160.44 Aligned_cols=207 Identities=14% Similarity=0.147 Sum_probs=158.2
Q ss_pred CCcccCCCCCCeEEEEEcC-CCCEEEEEcCCc-EEEEEecCCc------------eeEEeeee--cCCceEEEEEecCCC
Q 020784 77 AESTSSSPPPTLLHISFNQ-DHGCFAAGTDHG-FRIYNCDPFR------------EIFRRDFE--RGGGIGVVEMLFRCN 140 (321)
Q Consensus 77 ~~~~~~~~~~~V~~v~fs~-dg~~lasg~~~g-v~vw~~~~~~------------~~~~~~~~--~~~~v~~v~~~~~~~ 140 (321)
...+.+.|++.|+++.+.+ .|+|+++|+.+| +.|||++... ++..+.+. |.-.|..+.|-|...
T Consensus 35 d~d~~r~HgGsvNsL~id~tegrymlSGgadgsi~v~Dl~n~t~~e~s~li~k~~c~v~~~h~~~Hky~iss~~WyP~Dt 114 (397)
T KOG4283|consen 35 DKDFVRPHGGSVNSLQIDLTEGRYMLSGGADGSIAVFDLQNATDYEASGLIAKHKCIVAKQHENGHKYAISSAIWYPIDT 114 (397)
T ss_pred CcceeccCCCccceeeeccccceEEeecCCCccEEEEEeccccchhhccceeheeeeccccCCccceeeeeeeEEeeecC
Confidence 3445578889999999998 689999999887 5599986532 11111111 455677777877666
Q ss_pred eEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCC-----eEEEEECC-EEEEEEcCCcEEEEEEeccC
Q 020784 141 ILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRD-----RIIVVLEQ-KIFVYNFADLKLLHQIETIA 214 (321)
Q Consensus 141 ~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~-----~~~~~~~~-~I~iwd~~~~~~~~~l~~~~ 214 (321)
.+.+.+ +-|+++||||.++-+....|++++.|++-++++- .+++++.+ +|++-|+..|..-+++.+|.
T Consensus 115 GmFtss------SFDhtlKVWDtnTlQ~a~~F~me~~VYshamSp~a~sHcLiA~gtr~~~VrLCDi~SGs~sH~LsGHr 188 (397)
T KOG4283|consen 115 GMFTSS------SFDHTLKVWDTNTLQEAVDFKMEGKVYSHAMSPMAMSHCLIAAGTRDVQVRLCDIASGSFSHTLSGHR 188 (397)
T ss_pred ceeecc------cccceEEEeecccceeeEEeecCceeehhhcChhhhcceEEEEecCCCcEEEEeccCCcceeeecccc
Confidence 565544 1589999999999999999999999988777652 23444554 99999999999999999998
Q ss_pred CCCceEEEeeCCCceEEEeecCCCCcEEEEeeCC--cceEE--------------eeccccceeEEEECCCCCEEEEEeC
Q 020784 215 NPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYAS--KRTKF--------------IMAHDSRIACFALTQDGQLLATSST 278 (321)
Q Consensus 215 ~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~--~~~~~--------------l~~H~~~V~~vafspdg~~las~S~ 278 (321)
+.+..+.+++. ..++.++|+.||.|++||+.. ++..+ -.+|.+.|+.+||+.+|.++++++.
T Consensus 189 ~~vlaV~Wsp~--~e~vLatgsaDg~irlWDiRrasgcf~~lD~hn~k~~p~~~~n~ah~gkvngla~tSd~~~l~~~gt 266 (397)
T KOG4283|consen 189 DGVLAVEWSPS--SEWVLATGSADGAIRLWDIRRASGCFRVLDQHNTKRPPILKTNTAHYGKVNGLAWTSDARYLASCGT 266 (397)
T ss_pred CceEEEEeccC--ceeEEEecCCCceEEEEEeecccceeEEeecccCccCccccccccccceeeeeeecccchhhhhccC
Confidence 77666666554 456666899999999999752 22222 3467788999999999999999999
Q ss_pred CCcEEEEEEcCCCc
Q 020784 279 KGTLVRIFNTLDGT 292 (321)
Q Consensus 279 Dgt~IrIWd~~tg~ 292 (321)
|.. +|+|+..+|+
T Consensus 267 d~r-~r~wn~~~G~ 279 (397)
T KOG4283|consen 267 DDR-IRVWNMESGR 279 (397)
T ss_pred ccc-eEEeecccCc
Confidence 999 9999999875
No 72
>KOG1446 consensus Histone H3 (Lys4) methyltransferase complex and RNA cleavage factor II complex, subunit SWD2 [RNA processing and modification; Chromatin structure and dynamics; Posttranslational modification, protein turnover, chaperones]
Probab=99.87 E-value=3.9e-19 Score=152.89 Aligned_cols=222 Identities=10% Similarity=0.153 Sum_probs=148.2
Q ss_pred CCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeC
Q 020784 85 PPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDD 163 (321)
Q Consensus 85 ~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~ 163 (321)
..+|+++.|+.+|.+|+++++ |.++|||+..++....... ++.++..+++....+.+..++-. .|.+||.-++
T Consensus 14 ~~~i~sl~fs~~G~~litss~dDsl~LYd~~~g~~~~ti~s-kkyG~~~~~Fth~~~~~i~sStk-----~d~tIryLsl 87 (311)
T KOG1446|consen 14 NGKINSLDFSDDGLLLITSSEDDSLRLYDSLSGKQVKTINS-KKYGVDLACFTHHSNTVIHSSTK-----EDDTIRYLSL 87 (311)
T ss_pred CCceeEEEecCCCCEEEEecCCCeEEEEEcCCCceeeEeec-ccccccEEEEecCCceEEEccCC-----CCCceEEEEe
Confidence 458999999999999998776 6899999999887766654 34577788887777766665532 3678888888
Q ss_pred CCCcEEEEEeeCC-ceeEEEEeCC--eEEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCC
Q 020784 164 HQSRCIGELSFRS-EVRSVKLRRD--RIIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKG 239 (321)
Q Consensus 164 ~~~~~~~~~~~~~-~v~~v~~~~~--~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg 239 (321)
.+.+.++-|.+|. .|.+++.+|. .++.+ .|++||+||++..++..-+.... ..++++ +|+|.++|+ |...+
T Consensus 88 ~dNkylRYF~GH~~~V~sL~~sP~~d~FlS~S~D~tvrLWDlR~~~cqg~l~~~~--~pi~Af--Dp~GLifA~-~~~~~ 162 (311)
T KOG1446|consen 88 HDNKYLRYFPGHKKRVNSLSVSPKDDTFLSSSLDKTVRLWDLRVKKCQGLLNLSG--RPIAAF--DPEGLIFAL-ANGSE 162 (311)
T ss_pred ecCceEEEcCCCCceEEEEEecCCCCeEEecccCCeEEeeEecCCCCceEEecCC--CcceeE--CCCCcEEEE-ecCCC
Confidence 8888888777665 6777777763 33333 45688888887555544433322 123333 334455553 44444
Q ss_pred cEEEEeeC-----------------------------------------------Ccc-eEEeeccccc---eeEEEECC
Q 020784 240 QVRVEHYA-----------------------------------------------SKR-TKFIMAHDSR---IACFALTQ 268 (321)
Q Consensus 240 ~V~i~d~~-----------------------------------------------~~~-~~~l~~H~~~---V~~vafsp 268 (321)
.|+++|++ .+. ..++.+|... --+.+|+|
T Consensus 163 ~IkLyD~Rs~dkgPF~tf~i~~~~~~ew~~l~FS~dGK~iLlsT~~s~~~~lDAf~G~~~~tfs~~~~~~~~~~~a~ftP 242 (311)
T KOG1446|consen 163 LIKLYDLRSFDKGPFTTFSITDNDEAEWTDLEFSPDGKSILLSTNASFIYLLDAFDGTVKSTFSGYPNAGNLPLSATFTP 242 (311)
T ss_pred eEEEEEecccCCCCceeEccCCCCccceeeeEEcCCCCEEEEEeCCCcEEEEEccCCcEeeeEeeccCCCCcceeEEECC
Confidence 56665532 112 2234444332 25788999
Q ss_pred CCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEe
Q 020784 269 DGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 269 dg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~ 318 (321)
||+++.+|+.||+ |.||++++|+.+..++.-+.....++-++++|...+
T Consensus 243 ds~Fvl~gs~dg~-i~vw~~~tg~~v~~~~~~~~~~~~~~~fnP~~~mf~ 291 (311)
T KOG1446|consen 243 DSKFVLSGSDDGT-IHVWNLETGKKVAVLRGPNGGPVSCVRFNPRYAMFV 291 (311)
T ss_pred CCcEEEEecCCCc-EEEEEcCCCcEeeEecCCCCCCccccccCCceeeee
Confidence 9999999999999 999999999999988543333334444777665444
No 73
>KOG0275 consensus Conserved WD40 repeat-containing protein [General function prediction only]
Probab=99.87 E-value=1.7e-21 Score=167.88 Aligned_cols=225 Identities=14% Similarity=0.209 Sum_probs=176.0
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCcEE-EEEecCCceeEEeeee-------cCCceEEEEEecCCCeEEEEeCCCCCCC
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHGFR-IYNCDPFREIFRRDFE-------RGGGIGVVEMLFRCNILALVGGGPDPQY 153 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~gv~-vw~~~~~~~~~~~~~~-------~~~~v~~v~~~~~~~~~~~~sg~~~~~~ 153 (321)
.+..+-+.|..|+|||+||++|+.||+. |||..+++......++ ++..|.++.++-++..+++.+
T Consensus 210 Fg~KSh~EcA~FSPDgqyLvsgSvDGFiEVWny~~GKlrKDLkYQAqd~fMMmd~aVlci~FSRDsEMlAsGs------- 282 (508)
T KOG0275|consen 210 FGQKSHVECARFSPDGQYLVSGSVDGFIEVWNYTTGKLRKDLKYQAQDNFMMMDDAVLCISFSRDSEMLASGS------- 282 (508)
T ss_pred cccccchhheeeCCCCceEeeccccceeeeehhccchhhhhhhhhhhcceeecccceEEEeecccHHHhhccC-------
Confidence 3455678999999999999999999965 9999888754333221 567888888888888777666
Q ss_pred CCCcEEEEeCCCCcEEEEEe--eCCceeEEEEeCCe--EEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCc
Q 020784 154 PLNKVMIWDDHQSRCIGELS--FRSEVRSVKLRRDR--IIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGS 228 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~~~~--~~~~v~~v~~~~~~--~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~ 228 (321)
.||+||||.+++|+|++.|+ +...|+++.|+++. ++.+ .|.++|+--+..|++++.|.+|...+.-..|..++
T Consensus 283 qDGkIKvWri~tG~ClRrFdrAHtkGvt~l~FSrD~SqiLS~sfD~tvRiHGlKSGK~LKEfrGHsSyvn~a~ft~dG-- 360 (508)
T KOG0275|consen 283 QDGKIKVWRIETGQCLRRFDRAHTKGVTCLSFSRDNSQILSASFDQTVRIHGLKSGKCLKEFRGHSSYVNEATFTDDG-- 360 (508)
T ss_pred cCCcEEEEEEecchHHHHhhhhhccCeeEEEEccCcchhhcccccceEEEeccccchhHHHhcCccccccceEEcCCC--
Confidence 78999999999999999886 44579999999864 3333 46799999999999999999998877766766644
Q ss_pred eEEEeecCCCCcEEEEeeCCcc-eEEeec--cccceeEEEECCC-CCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcc-
Q 020784 229 LVLVCPGLQKGQVRVEHYASKR-TKFIMA--HDSRIACFALTQD-GQLLATSSTKGTLVRIFNTLDGTLLQEECCPSIS- 303 (321)
Q Consensus 229 ~~la~sGs~dg~V~i~d~~~~~-~~~l~~--H~~~V~~vafspd-g~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~- 303 (321)
..++ +++.||+|++|+..+.. +.+|+. -+-+|++|-.-|. ...++.|-..++ |.|-++. |+.+++|..|...
T Consensus 361 ~~ii-saSsDgtvkvW~~KtteC~~Tfk~~~~d~~vnsv~~~PKnpeh~iVCNrsnt-v~imn~q-GQvVrsfsSGkREg 437 (508)
T KOG0275|consen 361 HHII-SASSDGTVKVWHGKTTECLSTFKPLGTDYPVNSVILLPKNPEHFIVCNRSNT-VYIMNMQ-GQVVRSFSSGKREG 437 (508)
T ss_pred CeEE-EecCCccEEEecCcchhhhhhccCCCCcccceeEEEcCCCCceEEEEcCCCe-EEEEecc-ceEEeeeccCCccC
Confidence 5665 58999999999987654 667764 4567999988875 467888988888 9898875 8889998765442
Q ss_pred --e-eEEEeecCceEEEe
Q 020784 304 --A-QSGLWLSSAWLRVL 318 (321)
Q Consensus 304 --~-~~~~s~d~~~la~~ 318 (321)
. ...+|+-|.|+.++
T Consensus 438 GdFi~~~lSpkGewiYci 455 (508)
T KOG0275|consen 438 GDFINAILSPKGEWIYCI 455 (508)
T ss_pred CceEEEEecCCCcEEEEE
Confidence 2 23778999998653
No 74
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=99.87 E-value=2.2e-20 Score=169.35 Aligned_cols=225 Identities=12% Similarity=0.184 Sum_probs=158.3
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCC-cEEEEEecCCceeEE--eeee--cCCceEEEEEecCCCeEEEEeCCCCCCCCCC
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDH-GFRIYNCDPFREIFR--RDFE--RGGGIGVVEMLFRCNILALVGGGPDPQYPLN 156 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~-gv~vw~~~~~~~~~~--~~~~--~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~ 156 (321)
..|...|.++++.|.|-.|++|+-| .|++||+.-+.-... +.+. ..+.|..+.++..++.+++++|. .
T Consensus 164 ~hgtk~Vsal~~Dp~GaR~~sGs~Dy~v~~wDf~gMdas~~~fr~l~P~E~h~i~sl~ys~Tg~~iLvvsg~-------a 236 (641)
T KOG0772|consen 164 KHGTKIVSALAVDPSGARFVSGSLDYTVKFWDFQGMDASMRSFRQLQPCETHQINSLQYSVTGDQILVVSGS-------A 236 (641)
T ss_pred cCCceEEEEeeecCCCceeeeccccceEEEEecccccccchhhhccCcccccccceeeecCCCCeEEEEecC-------c
Confidence 3455689999999999999999974 589999864321111 1111 46789999999999999888865 6
Q ss_pred cEEEEeCCCCcEEEEEeeC-------------CceeEEEEeCC---eEE-EEECCEEEEEEcCC-cEEEEEEecc-----
Q 020784 157 KVMIWDDHQSRCIGELSFR-------------SEVRSVKLRRD---RII-VVLEQKIFVYNFAD-LKLLHQIETI----- 213 (321)
Q Consensus 157 ~v~iWD~~~~~~~~~~~~~-------------~~v~~v~~~~~---~~~-~~~~~~I~iwd~~~-~~~~~~l~~~----- 213 (321)
..+|+|-...+.+..++.. ..+++.+||++ .++ ++.|+++||||+.+ .+.++.|+..
T Consensus 237 qakl~DRdG~~~~e~~KGDQYI~Dm~nTKGHia~lt~g~whP~~k~~FlT~s~DgtlRiWdv~~~k~q~qVik~k~~~g~ 316 (641)
T KOG0772|consen 237 QAKLLDRDGFEIVEFSKGDQYIRDMYNTKGHIAELTCGCWHPDNKEEFLTCSYDGTLRIWDVNNTKSQLQVIKTKPAGGK 316 (641)
T ss_pred ceeEEccCCceeeeeeccchhhhhhhccCCceeeeeccccccCcccceEEecCCCcEEEEecCCchhheeEEeeccCCCc
Confidence 7999997655554443321 25778889975 233 44568999999964 3334444432
Q ss_pred CCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc----eEEeecccc--ceeEEEECCCCCEEEEEeCCCcEEEEEE
Q 020784 214 ANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR----TKFIMAHDS--RIACFALTQDGQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 214 ~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~----~~~l~~H~~--~V~~vafspdg~~las~S~Dgt~IrIWd 287 (321)
.-+...|++++ |+.++|. |..||.|.+|+..... .+.-++|.. .|+||+||+||++|+|-|.|++ +|+||
T Consensus 317 Rv~~tsC~~nr--dg~~iAa-gc~DGSIQ~W~~~~~~v~p~~~vk~AH~~g~~Itsi~FS~dg~~LlSRg~D~t-LKvWD 392 (641)
T KOG0772|consen 317 RVPVTSCAWNR--DGKLIAA-GCLDGSIQIWDKGSRTVRPVMKVKDAHLPGQDITSISFSYDGNYLLSRGFDDT-LKVWD 392 (641)
T ss_pred ccCceeeecCC--Ccchhhh-cccCCceeeeecCCcccccceEeeeccCCCCceeEEEeccccchhhhccCCCc-eeeee
Confidence 12334566555 5688884 9999999999975432 346678988 8999999999999999999999 99999
Q ss_pred cCCCc-EEEEEeCCCc----ceeEEEeecCceEEEe
Q 020784 288 TLDGT-LLQEECCPSI----SAQSGLWLSSAWLRVL 318 (321)
Q Consensus 288 ~~tg~-~i~~~~~g~~----~~~~~~s~d~~~la~~ 318 (321)
++..+ ++... .|-. ....+||+|-+.|..-
T Consensus 393 Lrq~kkpL~~~-tgL~t~~~~tdc~FSPd~kli~TG 427 (641)
T KOG0772|consen 393 LRQFKKPLNVR-TGLPTPFPGTDCCFSPDDKLILTG 427 (641)
T ss_pred ccccccchhhh-cCCCccCCCCccccCCCceEEEec
Confidence 99754 44433 2211 2234788888877653
No 75
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.86 E-value=6.1e-20 Score=164.48 Aligned_cols=222 Identities=17% Similarity=0.209 Sum_probs=167.6
Q ss_pred CCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 83 SPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
.|...|.+++.++||+|||+|+.+. |.||++++.+.+..... |.+.|..+++-..++.+..++ .|++|++|
T Consensus 200 ~h~keil~~avS~Dgkylatgg~d~~v~Iw~~~t~ehv~~~~g-hr~~V~~L~fr~gt~~lys~s-------~Drsvkvw 271 (479)
T KOG0299|consen 200 GHVKEILTLAVSSDGKYLATGGRDRHVQIWDCDTLEHVKVFKG-HRGAVSSLAFRKGTSELYSAS-------ADRSVKVW 271 (479)
T ss_pred cccceeEEEEEcCCCcEEEecCCCceEEEecCcccchhhcccc-cccceeeeeeecCccceeeee-------cCCceEEE
Confidence 6778999999999999999999865 66999999987766554 678888888887788888777 78999999
Q ss_pred eCCCCcEEEEEe-eCCceeEEEEeC-CeEEEEE--CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCC
Q 020784 162 DDHQSRCIGELS-FRSEVRSVKLRR-DRIIVVL--EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQ 237 (321)
Q Consensus 162 D~~~~~~~~~~~-~~~~v~~v~~~~-~~~~~~~--~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~ 237 (321)
+++....+.++- ++..|.++.... .+.+.+. |.++++|++.... .-.+.++....-+++|-.+ .-++ +|+.
T Consensus 272 ~~~~~s~vetlyGHqd~v~~IdaL~reR~vtVGgrDrT~rlwKi~ees-qlifrg~~~sidcv~~In~---~Hfv-sGSd 346 (479)
T KOG0299|consen 272 SIDQLSYVETLYGHQDGVLGIDALSRERCVTVGGRDRTVRLWKIPEES-QLIFRGGEGSIDCVAFIND---EHFV-SGSD 346 (479)
T ss_pred ehhHhHHHHHHhCCccceeeechhcccceEEeccccceeEEEeccccc-eeeeeCCCCCeeeEEEecc---ccee-eccC
Confidence 998887776654 445788887544 4444443 5799999995332 2345555555556666543 2344 5999
Q ss_pred CCcEEEEeeCCcc-eEEe-ecc-----------ccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCC----cEEEEEeCC
Q 020784 238 KGQVRVEHYASKR-TKFI-MAH-----------DSRIACFALTQDGQLLATSSTKGTLVRIFNTLDG----TLLQEECCP 300 (321)
Q Consensus 238 dg~V~i~d~~~~~-~~~l-~~H-----------~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg----~~i~~~~~g 300 (321)
||.|.+|++..+. +.+. .+| ...|++|+..|...+|||||.+|. ||+|-+.+| .++..+...
T Consensus 347 nG~IaLWs~~KKkplf~~~~AHgv~~~~~~~~~~~Witsla~i~~sdL~asGS~~G~-vrLW~i~~g~r~i~~l~~ls~~ 425 (479)
T KOG0299|consen 347 NGSIALWSLLKKKPLFTSRLAHGVIPELDPVNGNFWITSLAVIPGSDLLASGSWSGC-VRLWKIEDGLRAINLLYSLSLV 425 (479)
T ss_pred CceEEEeeecccCceeEeeccccccCCccccccccceeeeEecccCceEEecCCCCc-eEEEEecCCccccceeeecccc
Confidence 9999999987654 4432 233 237999999999999999999999 999999988 466666654
Q ss_pred CcceeEEEeecCceEEEe
Q 020784 301 SISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 301 ~~~~~~~~s~d~~~la~~ 318 (321)
.-...++|+.||++|-++
T Consensus 426 GfVNsl~f~~sgk~ivag 443 (479)
T KOG0299|consen 426 GFVNSLAFSNSGKRIVAG 443 (479)
T ss_pred cEEEEEEEccCCCEEEEe
Confidence 555566889999977553
No 76
>PTZ00421 coronin; Provisional
Probab=99.85 E-value=6.6e-19 Score=167.95 Aligned_cols=220 Identities=12% Similarity=-0.020 Sum_probs=152.4
Q ss_pred CeEEEEEcCCCCEEEEEcCCcE-EEEEecCCceeE-------------EeeeecCCceEEEEEec-CCCeEEEEeCCCCC
Q 020784 87 TLLHISFNQDHGCFAAGTDHGF-RIYNCDPFREIF-------------RRDFERGGGIGVVEMLF-RCNILALVGGGPDP 151 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~~gv-~vw~~~~~~~~~-------------~~~~~~~~~v~~v~~~~-~~~~~~~~sg~~~~ 151 (321)
.|+...+++|+..+++++.+.+ ..|+..-+..+. .... |.+.|..++|++ +++.+++++
T Consensus 22 ~i~~~~~~~d~~~~~~~n~~~~a~~w~~~gg~~v~~~~~~G~~~~~~~~l~G-H~~~V~~v~fsP~d~~~LaSgS----- 95 (493)
T PTZ00421 22 NVTPSTALWDCSNTIACNDRFIAVPWQQLGSTAVLKHTDYGKLASNPPILLG-QEGPIIDVAFNPFDPQKLFTAS----- 95 (493)
T ss_pred ccccccccCCCCCcEeECCceEEEEEecCCceEEeeccccccCCCCCceEeC-CCCCEEEEEEcCCCCCEEEEEe-----
Confidence 4666667777655555555443 366543221111 1111 678899999987 777787777
Q ss_pred CCCCCcEEEEeCCCCc-------EEEEEeeC-CceeEEEEeCC---eEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCce
Q 020784 152 QYPLNKVMIWDDHQSR-------CIGELSFR-SEVRSVKLRRD---RIIVVL-EQKIFVYNFADLKLLHQIETIANPKGL 219 (321)
Q Consensus 152 ~~~d~~v~iWD~~~~~-------~~~~~~~~-~~v~~v~~~~~---~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~ 219 (321)
.|++|+|||+.++. .+..+..+ ..|.+++|++. .++.++ |++|+|||+.+++.+..+..|...+..
T Consensus 96 --~DgtIkIWdi~~~~~~~~~~~~l~~L~gH~~~V~~l~f~P~~~~iLaSgs~DgtVrIWDl~tg~~~~~l~~h~~~V~s 173 (493)
T PTZ00421 96 --EDGTIMGWGIPEEGLTQNISDPIVHLQGHTKKVGIVSFHPSAMNVLASAGADMVVNVWDVERGKAVEVIKCHSDQITS 173 (493)
T ss_pred --CCCEEEEEecCCCccccccCcceEEecCCCCcEEEEEeCcCCCCEEEEEeCCCEEEEEECCCCeEEEEEcCCCCceEE
Confidence 68999999997653 34445544 57999999974 345444 579999999999999999888776666
Q ss_pred EEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccc-eeEEEECCCCCEEEEEe----CCCcEEEEEEcCCCc-
Q 020784 220 CAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSR-IACFALTQDGQLLATSS----TKGTLVRIFNTLDGT- 292 (321)
Q Consensus 220 ~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~-V~~vafspdg~~las~S----~Dgt~IrIWd~~tg~- 292 (321)
+++++ ++.+|+ +|+.||+|+|||..++. +.++.+|.+. +..+.|.+++.+|++++ .|++ |+|||+++..
T Consensus 174 la~sp--dG~lLa-tgs~Dg~IrIwD~rsg~~v~tl~~H~~~~~~~~~w~~~~~~ivt~G~s~s~Dr~-VklWDlr~~~~ 249 (493)
T PTZ00421 174 LEWNL--DGSLLC-TTSKDKKLNIIDPRDGTIVSSVEAHASAKSQRCLWAKRKDLIITLGCSKSQQRQ-IMLWDTRKMAS 249 (493)
T ss_pred EEEEC--CCCEEE-EecCCCEEEEEECCCCcEEEEEecCCCCcceEEEEcCCCCeEEEEecCCCCCCe-EEEEeCCCCCC
Confidence 66665 557787 59999999999998765 5678889865 45778999887777754 4788 9999999764
Q ss_pred EEEEEeCCCccee--EEEeecCceEEEe
Q 020784 293 LLQEECCPSISAQ--SGLWLSSAWLRVL 318 (321)
Q Consensus 293 ~i~~~~~g~~~~~--~~~s~d~~~la~~ 318 (321)
.+........... ..+++|+.+|+++
T Consensus 250 p~~~~~~d~~~~~~~~~~d~d~~~L~lg 277 (493)
T PTZ00421 250 PYSTVDLDQSSALFIPFFDEDTNLLYIG 277 (493)
T ss_pred ceeEeccCCCCceEEEEEcCCCCEEEEE
Confidence 4443332222222 2566788887765
No 77
>KOG0294 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.85 E-value=1.6e-19 Score=155.11 Aligned_cols=211 Identities=18% Similarity=0.236 Sum_probs=165.3
Q ss_pred CCCCCCeEEEEEcCCCC--EEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcE
Q 020784 82 SSPPPTLLHISFNQDHG--CFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~--~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
..|.+.|+++.|.++-. +|.+|++|| |.+|+...-..+..... |.+.|..++++|.+.+-..++ .|+.+
T Consensus 80 l~HagsitaL~F~~~~S~shLlS~sdDG~i~iw~~~~W~~~~slK~-H~~~Vt~lsiHPS~KLALsVg-------~D~~l 151 (362)
T KOG0294|consen 80 LSHAGSITALKFYPPLSKSHLLSGSDDGHIIIWRVGSWELLKSLKA-HKGQVTDLSIHPSGKLALSVG-------GDQVL 151 (362)
T ss_pred eccccceEEEEecCCcchhheeeecCCCcEEEEEcCCeEEeeeecc-cccccceeEecCCCceEEEEc-------CCcee
Confidence 35678999999999875 889999877 77999988876655554 788899999999887666666 47999
Q ss_pred EEEeCCCCcEEEEEeeCCceeEEEEeC--CeEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecC
Q 020784 159 MIWDDHQSRCIGELSFRSEVRSVKLRR--DRIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGL 236 (321)
Q Consensus 159 ~iWD~~~~~~~~~~~~~~~v~~v~~~~--~~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs 236 (321)
+.||+-+|+.-..+........|.|.+ +++++...+.|-+|.+.+..+...+.. +....++-+. ++..+++ |.
T Consensus 152 r~WNLV~Gr~a~v~~L~~~at~v~w~~~Gd~F~v~~~~~i~i~q~d~A~v~~~i~~---~~r~l~~~~l-~~~~L~v-G~ 226 (362)
T KOG0294|consen 152 RTWNLVRGRVAFVLNLKNKATLVSWSPQGDHFVVSGRNKIDIYQLDNASVFREIEN---PKRILCATFL-DGSELLV-GG 226 (362)
T ss_pred eeehhhcCccceeeccCCcceeeEEcCCCCEEEEEeccEEEEEecccHhHhhhhhc---cccceeeeec-CCceEEE-ec
Confidence 999999998776677666666688876 468888889999999988776655543 2334444443 3345553 89
Q ss_pred CCCcEEEEeeCC-cceEEeeccccceeEEEE--CCCCCEEEEEeCCCcEEEEEEcCCC-----cEEEEEeCCCcceeE
Q 020784 237 QKGQVRVEHYAS-KRTKFIMAHDSRIACFAL--TQDGQLLATSSTKGTLVRIFNTLDG-----TLLQEECCPSISAQS 306 (321)
Q Consensus 237 ~dg~V~i~d~~~-~~~~~l~~H~~~V~~vaf--spdg~~las~S~Dgt~IrIWd~~tg-----~~i~~~~~g~~~~~~ 306 (321)
.|+.|.+||... .++..+.+|...|-.+.+ .|++.+|+|+|.||. |+|||++.. +++..++.+.....+
T Consensus 227 d~~~i~~~D~ds~~~~~~~~AH~~RVK~i~~~~~~~~~~lvTaSSDG~-I~vWd~~~~~k~~~~~l~e~n~~~RltCl 303 (362)
T KOG0294|consen 227 DNEWISLKDTDSDTPLTEFLAHENRVKDIASYTNPEHEYLVTASSDGF-IKVWDIDMETKKRPTLLAELNTNVRLTCL 303 (362)
T ss_pred CCceEEEeccCCCccceeeecchhheeeeEEEecCCceEEEEeccCce-EEEEEccccccCCcceeEEeecCCcccee
Confidence 999999999874 457899999999999995 478999999999999 999999876 567777766554444
No 78
>KOG0973 consensus Histone transcription regulator HIRA, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=99.85 E-value=1.6e-19 Score=176.14 Aligned_cols=230 Identities=14% Similarity=0.115 Sum_probs=171.8
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCCcE-EEEEecC------C----c--------eeEEeeeecCCceEEEEEecCCCe
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDHGF-RIYNCDP------F----R--------EIFRRDFERGGGIGVVEMLFRCNI 141 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~gv-~vw~~~~------~----~--------~~~~~~~~~~~~v~~v~~~~~~~~ 141 (321)
-..|.+.|+|+.|++||++||+|+||.+ .||+... + + ....... |...|..++|++++.+
T Consensus 65 m~~h~~sv~CVR~S~dG~~lAsGSDD~~v~iW~~~~~~~~~~fgs~g~~~~vE~wk~~~~l~~-H~~DV~Dv~Wsp~~~~ 143 (942)
T KOG0973|consen 65 MDDHDGSVNCVRFSPDGSYLASGSDDRLVMIWERAEIGSGTVFGSTGGAKNVESWKVVSILRG-HDSDVLDVNWSPDDSL 143 (942)
T ss_pred eccccCceeEEEECCCCCeEeeccCcceEEEeeecccCCcccccccccccccceeeEEEEEec-CCCccceeccCCCccE
Confidence 4567889999999999999999999885 4998762 1 0 1112222 7889999999999999
Q ss_pred EEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeC-CceeEEEEeCCeEEEE--EC-CEEEEEEcCCcEEEEEEeccCC--
Q 020784 142 LALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFR-SEVRSVKLRRDRIIVV--LE-QKIFVYNFADLKLLHQIETIAN-- 215 (321)
Q Consensus 142 ~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~-~~v~~v~~~~~~~~~~--~~-~~I~iwd~~~~~~~~~l~~~~~-- 215 (321)
++.++ .|++|.|||.++++.+..+..| +.|..+.|.|-+-+.+ ++ ++|+||++.+..+.+.+..+..
T Consensus 144 lvS~s-------~DnsViiwn~~tF~~~~vl~~H~s~VKGvs~DP~Gky~ASqsdDrtikvwrt~dw~i~k~It~pf~~~ 216 (942)
T KOG0973|consen 144 LVSVS-------LDNSVIIWNAKTFELLKVLRGHQSLVKGVSWDPIGKYFASQSDDRTLKVWRTSDWGIEKSITKPFEES 216 (942)
T ss_pred EEEec-------ccceEEEEccccceeeeeeecccccccceEECCccCeeeeecCCceEEEEEcccceeeEeeccchhhC
Confidence 98888 7899999999999888888765 5799999998544443 43 5999999998888888876543
Q ss_pred --CCceEEEeeCCCceEEEeecCCCC---cEEEEeeCCcc-eEEeeccccceeEEEECCC-----CC------------E
Q 020784 216 --PKGLCAVSQGVGSLVLVCPGLQKG---QVRVEHYASKR-TKFIMAHDSRIACFALTQD-----GQ------------L 272 (321)
Q Consensus 216 --~~~~~~~s~~~d~~~la~sGs~dg---~V~i~d~~~~~-~~~l~~H~~~V~~vafspd-----g~------------~ 272 (321)
......+++.|||.+|++.-..+| .+.|.+..+-. -+.|-||..+|.+++|+|. .. .
T Consensus 217 ~~~T~f~RlSWSPDG~~las~nA~n~~~~~~~IieR~tWk~~~~LvGH~~p~evvrFnP~lfe~~~~ng~~~~~~~~y~i 296 (942)
T KOG0973|consen 217 PLTTFFLRLSWSPDGHHLASPNAVNGGKSTIAIIERGTWKVDKDLVGHSAPVEVVRFNPKLFERNNKNGTSTQPNCYYCI 296 (942)
T ss_pred CCcceeeecccCCCcCeecchhhccCCcceeEEEecCCceeeeeeecCCCceEEEEeChHHhccccccCCccCCCcceEE
Confidence 223566788888899986433333 56665555433 5689999999999999983 12 6
Q ss_pred EEEEeCCCcEEEEEEcCCCcEEEEEeC--CCcceeEEEeecCceEEEee
Q 020784 273 LATSSTKGTLVRIFNTLDGTLLQEECC--PSISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 273 las~S~Dgt~IrIWd~~tg~~i~~~~~--g~~~~~~~~s~d~~~la~~~ 319 (321)
+|+||.|++ |-||.....+.+--... ......++.++||.-|-+|+
T Consensus 297 ~AvgSqDrS-lSVW~T~~~RPl~vi~~lf~~SI~DmsWspdG~~LfacS 344 (942)
T KOG0973|consen 297 AAVGSQDRS-LSVWNTALPRPLFVIHNLFNKSIVDMSWSPDGFSLFACS 344 (942)
T ss_pred EEEecCCcc-EEEEecCCCCchhhhhhhhcCceeeeeEcCCCCeEEEEe
Confidence 899999999 99999987765433222 33333446777787776664
No 79
>KOG0268 consensus Sof1-like rRNA processing protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.85 E-value=9.7e-21 Score=165.20 Aligned_cols=222 Identities=12% Similarity=0.075 Sum_probs=165.5
Q ss_pred CCCCCCeEEEEEcCCC-CEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 82 SSPPPTLLHISFNQDH-GCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg-~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
.+|...|.|++=+|.. ..+|+|+.|| |+|||+....+...... |.|-|..+++.. ..+++++ +|++||
T Consensus 63 ~gHrdGV~~lakhp~~ls~~aSGs~DG~VkiWnlsqR~~~~~f~A-H~G~V~Gi~v~~--~~~~tvg-------dDKtvK 132 (433)
T KOG0268|consen 63 DGHRDGVSCLAKHPNKLSTVASGSCDGEVKIWNLSQRECIRTFKA-HEGLVRGICVTQ--TSFFTVG-------DDKTVK 132 (433)
T ss_pred cccccccchhhcCcchhhhhhccccCceEEEEehhhhhhhheeec-ccCceeeEEecc--cceEEec-------CCccee
Confidence 6899999999999987 6789999877 78999998877666665 788899888876 5566677 689999
Q ss_pred EEeCCCCcEEEEEeeCCceeEEEEeCCeEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCC
Q 020784 160 IWDDHQSRCIGELSFRSEVRSVKLRRDRIIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQK 238 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~d 238 (321)
.|..+- ..+.++...+.+..+..+...-..++ +..|.|||.+....++++..+...+.++.+++.. -.+|+ ++..|
T Consensus 133 ~wk~~~-~p~~tilg~s~~~gIdh~~~~~~FaTcGe~i~IWD~~R~~Pv~smswG~Dti~svkfNpvE-TsILa-s~~sD 209 (433)
T KOG0268|consen 133 QWKIDG-PPLHTILGKSVYLGIDHHRKNSVFATCGEQIDIWDEQRDNPVSSMSWGADSISSVKFNPVE-TSILA-SCASD 209 (433)
T ss_pred eeeccC-CcceeeeccccccccccccccccccccCceeeecccccCCccceeecCCCceeEEecCCCc-chhee-eeccC
Confidence 998765 46667777778888887765444444 4599999998878888887665555555555543 23444 45566
Q ss_pred CcEEEEeeCC-------------------------------------------cceEEeeccccceeEEEECCCCCEEEE
Q 020784 239 GQVRVEHYAS-------------------------------------------KRTKFIMAHDSRIACFALTQDGQLLAT 275 (321)
Q Consensus 239 g~V~i~d~~~-------------------------------------------~~~~~l~~H~~~V~~vafspdg~~las 275 (321)
+.|.++|+.. .++.+.++|.++|.+|.|||.|+-|+|
T Consensus 210 rsIvLyD~R~~~Pl~KVi~~mRTN~IswnPeafnF~~a~ED~nlY~~DmR~l~~p~~v~~dhvsAV~dVdfsptG~Efvs 289 (433)
T KOG0268|consen 210 RSIVLYDLRQASPLKKVILTMRTNTICWNPEAFNFVAANEDHNLYTYDMRNLSRPLNVHKDHVSAVMDVDFSPTGQEFVS 289 (433)
T ss_pred CceEEEecccCCccceeeeeccccceecCccccceeeccccccceehhhhhhcccchhhcccceeEEEeccCCCcchhcc
Confidence 6676666432 234567889999999999999999999
Q ss_pred EeCCCcEEEEEEcCCCcEEEEEe--CCCcceeEEEeecCceEEE
Q 020784 276 SSTKGTLVRIFNTLDGTLLQEEC--CPSISAQSGLWLSSAWLRV 317 (321)
Q Consensus 276 ~S~Dgt~IrIWd~~tg~~i~~~~--~g~~~~~~~~s~d~~~la~ 317 (321)
||.|++ ||||.+..|.--..|. +=.....+.+|.|++|+-.
T Consensus 290 gsyDks-IRIf~~~~~~SRdiYhtkRMq~V~~Vk~S~Dskyi~S 332 (433)
T KOG0268|consen 290 GSYDKS-IRIFPVNHGHSRDIYHTKRMQHVFCVKYSMDSKYIIS 332 (433)
T ss_pred ccccce-EEEeecCCCcchhhhhHhhhheeeEEEEeccccEEEe
Confidence 999999 9999999876543332 2233445577888888743
No 80
>KOG0308 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.85 E-value=2.1e-20 Score=173.55 Aligned_cols=199 Identities=13% Similarity=0.248 Sum_probs=148.9
Q ss_pred CCCCEEEEEcCCc-EEEEEecCCcee------EEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCC-
Q 020784 95 QDHGCFAAGTDHG-FRIYNCDPFREI------FRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQS- 166 (321)
Q Consensus 95 ~dg~~lasg~~~g-v~vw~~~~~~~~------~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~- 166 (321)
|.+++|.+|+.|| +++|+....... ...+. |...+..+....+++.++.++ .|-+|++|+...+
T Consensus 35 ~~~ryLfTgGRDg~i~~W~~~~d~~~~s~~~~asme~-HsDWVNDiiL~~~~~tlIS~S-------sDtTVK~W~~~~~~ 106 (735)
T KOG0308|consen 35 PNGRYLFTGGRDGIIRLWSVTQDSNEPSTPYIASMEH-HSDWVNDIILCGNGKTLISAS-------SDTTVKVWNAHKDN 106 (735)
T ss_pred CCCceEEecCCCceEEEeccccccCCcccchhhhhhh-hHhHHhhHHhhcCCCceEEec-------CCceEEEeecccCc
Confidence 4678899999887 679987544321 22222 667777777777888888888 7899999999877
Q ss_pred -cEEEEEeeC-CceeEEEE-eCCeEEEEE---CCEEEEEEcCCc--EEEEEEec------c-CCCCceEEEeeCCCceEE
Q 020784 167 -RCIGELSFR-SEVRSVKL-RRDRIIVVL---EQKIFVYNFADL--KLLHQIET------I-ANPKGLCAVSQGVGSLVL 231 (321)
Q Consensus 167 -~~~~~~~~~-~~v~~v~~-~~~~~~~~~---~~~I~iwd~~~~--~~~~~l~~------~-~~~~~~~~~s~~~d~~~l 231 (321)
-|..++..| ..|.+++. -++...+++ |+.|++||+..+ +++.++.. . .....+.++..++.+.++
T Consensus 107 ~~c~stir~H~DYVkcla~~ak~~~lvaSgGLD~~IflWDin~~~~~l~~s~n~~t~~sl~sG~k~siYSLA~N~t~t~i 186 (735)
T KOG0308|consen 107 TFCMSTIRTHKDYVKCLAYIAKNNELVASGGLDRKIFLWDINTGTATLVASFNNVTVNSLGSGPKDSIYSLAMNQTGTII 186 (735)
T ss_pred chhHhhhhcccchheeeeecccCceeEEecCCCccEEEEEccCcchhhhhhccccccccCCCCCccceeeeecCCcceEE
Confidence 355566544 47999988 444444443 579999999876 44444421 1 112345566666666677
Q ss_pred EeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcce
Q 020784 232 VCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISA 304 (321)
Q Consensus 232 a~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~ 304 (321)
+ +|+..+.+++||-.+.. ++.++||+..|++|..+.||+.++|+|.||+ ||+||+...+|+.+|. .|...
T Consensus 187 v-sGgtek~lr~wDprt~~kimkLrGHTdNVr~ll~~dDGt~~ls~sSDgt-IrlWdLgqQrCl~T~~-vH~e~ 257 (735)
T KOG0308|consen 187 V-SGGTEKDLRLWDPRTCKKIMKLRGHTDNVRVLLVNDDGTRLLSASSDGT-IRLWDLGQQRCLATYI-VHKEG 257 (735)
T ss_pred E-ecCcccceEEeccccccceeeeeccccceEEEEEcCCCCeEeecCCCce-EEeeeccccceeeeEE-eccCc
Confidence 6 69999999999988754 7789999999999999999999999999999 9999999999999985 44443
No 81
>KOG0267 consensus Microtubule severing protein katanin p80 subunit B (contains WD40 repeats) [Cell cycle control, cell division, chromosome partitioning]
Probab=99.84 E-value=5.8e-21 Score=179.01 Aligned_cols=221 Identities=10% Similarity=0.125 Sum_probs=179.0
Q ss_pred CCCCCeEEEEEcCCCCEEEEEcCCcEE-EEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 83 SPPPTLLHISFNQDHGCFAAGTDHGFR-IYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg~~lasg~~~gv~-vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
.|...|.|+..-..++.+++|+.+-.. +|.+.....+..+.. |..+|.++.+.+...+++.++ .+|+||+|
T Consensus 26 ~hsaav~~lk~~~s~r~~~~Gg~~~k~~L~~i~kp~~i~S~~~-hespIeSl~f~~~E~Llaags-------asgtiK~w 97 (825)
T KOG0267|consen 26 AHSAAVGCLKIRKSSRSLVTGGEDEKVNLWAIGKPNAITSLTG-HESPIESLTFDTSERLLAAGS-------ASGTIKVW 97 (825)
T ss_pred hhhhhhceeeeeccceeeccCCCceeeccccccCCchhheeec-cCCcceeeecCcchhhhcccc-------cCCceeee
Confidence 455678888887778999999997755 999876665555555 789999999888877776666 67999999
Q ss_pred eCCCCcEEEEEeeCC-ceeEEEEeCCeEEEE---ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCC
Q 020784 162 DDHQSRCIGELSFRS-EVRSVKLRRDRIIVV---LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQ 237 (321)
Q Consensus 162 D~~~~~~~~~~~~~~-~v~~v~~~~~~~~~~---~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~ 237 (321)
|++..+.++++.++. .+.+|.|++..-+.+ ++..+++||++...+.+.+.+|...+.+..|+|+ |.+++ +|+.
T Consensus 98 DleeAk~vrtLtgh~~~~~sv~f~P~~~~~a~gStdtd~~iwD~Rk~Gc~~~~~s~~~vv~~l~lsP~--Gr~v~-~g~e 174 (825)
T KOG0267|consen 98 DLEEAKIVRTLTGHLLNITSVDFHPYGEFFASGSTDTDLKIWDIRKKGCSHTYKSHTRVVDVLRLSPD--GRWVA-SGGE 174 (825)
T ss_pred ehhhhhhhhhhhccccCcceeeeccceEEeccccccccceehhhhccCceeeecCCcceeEEEeecCC--Cceee-ccCC
Confidence 999999888887664 788999999765553 3569999999999999999998777777777765 58998 5999
Q ss_pred CCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCc-ceeEEEeecCceE
Q 020784 238 KGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSI-SAQSGLWLSSAWL 315 (321)
Q Consensus 238 dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~-~~~~~~s~d~~~l 315 (321)
|.+|+|||...+. ++.|+.|...|.++.|+|..-++++||.|++ |++||+++.+++........ .....|.++++-+
T Consensus 175 d~tvki~d~~agk~~~ef~~~e~~v~sle~hp~e~Lla~Gs~d~t-v~f~dletfe~I~s~~~~~~~v~~~~fn~~~~~~ 253 (825)
T KOG0267|consen 175 DNTVKIWDLTAGKLSKEFKSHEGKVQSLEFHPLEVLLAPGSSDRT-VRFWDLETFEVISSGKPETDGVRSLAFNPDGKIV 253 (825)
T ss_pred cceeeeecccccccccccccccccccccccCchhhhhccCCCCce-eeeeccceeEEeeccCCccCCceeeeecCCceee
Confidence 9999999997766 5699999999999999999999999999999 99999999888876644322 2233666666543
No 82
>KOG0305 consensus Anaphase promoting complex, Cdc20, Cdh1, and Ama1 subunits [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=99.84 E-value=3.6e-19 Score=165.41 Aligned_cols=227 Identities=12% Similarity=0.081 Sum_probs=174.0
Q ss_pred CCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 83 SPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
.+++.|+++.|+++|++||+|..+| |.|||....+........|...|.+++|. ...+.+.+ .|+.|.++
T Consensus 215 ~~~~~vtSv~ws~~G~~LavG~~~g~v~iwD~~~~k~~~~~~~~h~~rvg~laW~--~~~lssGs-------r~~~I~~~ 285 (484)
T KOG0305|consen 215 FGEELVTSVKWSPDGSHLAVGTSDGTVQIWDVKEQKKTRTLRGSHASRVGSLAWN--SSVLSSGS-------RDGKILNH 285 (484)
T ss_pred cCCCceEEEEECCCCCEEEEeecCCeEEEEehhhccccccccCCcCceeEEEecc--CceEEEec-------CCCcEEEE
Confidence 3378999999999999999999977 66999988776555543246677777775 43333333 46999999
Q ss_pred eCCCCcEEEE-Ee-eCCceeEEEEeCCeEEEEE---CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecC
Q 020784 162 DDHQSRCIGE-LS-FRSEVRSVKLRRDRIIVVL---EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGL 236 (321)
Q Consensus 162 D~~~~~~~~~-~~-~~~~v~~v~~~~~~~~~~~---~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs 236 (321)
|++..+.+.. +. +..+|..+.|+++....++ |+.+.|||....+.+.++..|...+..++++|...+.+....|+
T Consensus 286 dvR~~~~~~~~~~~H~qeVCgLkws~d~~~lASGgnDN~~~Iwd~~~~~p~~~~~~H~aAVKA~awcP~q~~lLAsGGGs 365 (484)
T KOG0305|consen 286 DVRISQHVVSTLQGHRQEVCGLKWSPDGNQLASGGNDNVVFIWDGLSPEPKFTFTEHTAAVKALAWCPWQSGLLATGGGS 365 (484)
T ss_pred EEecchhhhhhhhcccceeeeeEECCCCCeeccCCCccceEeccCCCccccEEEeccceeeeEeeeCCCccCceEEcCCC
Confidence 9998775544 54 3458999999987655543 46999999988889999999999999999999876543333456
Q ss_pred CCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEE-EeCCCcEEEEEEcCCCcEEEEEeCCCcceeE--EEeecCc
Q 020784 237 QKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLAT-SSTKGTLVRIFNTLDGTLLQEECCPSISAQS--GLWLSSA 313 (321)
Q Consensus 237 ~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las-~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~--~~s~d~~ 313 (321)
.|+.|++||..++.......-.+.|.+|.|++..+-|++ -+.-...|.||+..+.+.+..+ .||...++ ++++||+
T Consensus 366 ~D~~i~fwn~~~g~~i~~vdtgsQVcsL~Wsk~~kEi~sthG~s~n~i~lw~~ps~~~~~~l-~gH~~RVl~la~SPdg~ 444 (484)
T KOG0305|consen 366 ADRCIKFWNTNTGARIDSVDTGSQVCSLIWSKKYKELLSTHGYSENQITLWKYPSMKLVAEL-LGHTSRVLYLALSPDGE 444 (484)
T ss_pred cccEEEEEEcCCCcEecccccCCceeeEEEcCCCCEEEEecCCCCCcEEEEeccccceeeee-cCCcceeEEEEECCCCC
Confidence 799999999988775554556678999999998865555 3443334999999999999888 57776655 6689999
Q ss_pred eEEEee
Q 020784 314 WLRVLR 319 (321)
Q Consensus 314 ~la~~~ 319 (321)
+++++.
T Consensus 445 ~i~t~a 450 (484)
T KOG0305|consen 445 TIVTGA 450 (484)
T ss_pred EEEEec
Confidence 998864
No 83
>KOG0646 consensus WD40 repeat protein [General function prediction only]
Probab=99.84 E-value=3.7e-19 Score=159.72 Aligned_cols=202 Identities=14% Similarity=0.195 Sum_probs=155.1
Q ss_pred CCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEe
Q 020784 84 PPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWD 162 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD 162 (321)
-+++|.|++-+|+|.+|+.|+..+ +.+|.+.++..+..+.. |-..|.++.++-++..+++++ .|+.|.+|+
T Consensus 80 ~Pg~v~al~s~n~G~~l~ag~i~g~lYlWelssG~LL~v~~a-HYQ~ITcL~fs~dgs~iiTgs-------kDg~V~vW~ 151 (476)
T KOG0646|consen 80 LPGPVHALASSNLGYFLLAGTISGNLYLWELSSGILLNVLSA-HYQSITCLKFSDDGSHIITGS-------KDGAVLVWL 151 (476)
T ss_pred cccceeeeecCCCceEEEeecccCcEEEEEeccccHHHHHHh-hccceeEEEEeCCCcEEEecC-------CCccEEEEE
Confidence 456899999999999999997755 88999999987766643 778999999998888887777 789999997
Q ss_pred CC-------C--CcEEEEEeeCC-ceeEEEEeCC----eEEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCC
Q 020784 163 DH-------Q--SRCIGELSFRS-EVRSVKLRRD----RIIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVG 227 (321)
Q Consensus 163 ~~-------~--~~~~~~~~~~~-~v~~v~~~~~----~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d 227 (321)
+- + -+....+..|. +|+.+..... +++.+ .|.++|+||+..+.++.++... ..+.++..++.
T Consensus 152 l~~lv~a~~~~~~~p~~~f~~HtlsITDl~ig~Gg~~~rl~TaS~D~t~k~wdlS~g~LLlti~fp---~si~av~lDpa 228 (476)
T KOG0646|consen 152 LTDLVSADNDHSVKPLHIFSDHTLSITDLQIGSGGTNARLYTASEDRTIKLWDLSLGVLLLTITFP---SSIKAVALDPA 228 (476)
T ss_pred EEeecccccCCCccceeeeccCcceeEEEEecCCCccceEEEecCCceEEEEEeccceeeEEEecC---CcceeEEEccc
Confidence 42 1 12333344343 6887776543 44444 4679999999999999888754 33444444444
Q ss_pred ceEEEeecCCCCcEEEEeeCC-----------------cceEEeecccc--ceeEEEECCCCCEEEEEeCCCcEEEEEEc
Q 020784 228 SLVLVCPGLQKGQVRVEHYAS-----------------KRTKFIMAHDS--RIACFALTQDGQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 228 ~~~la~sGs~dg~V~i~d~~~-----------------~~~~~l~~H~~--~V~~vafspdg~~las~S~Dgt~IrIWd~ 288 (321)
...+. .|+.+|.|.+.++.. .+...+.+|.+ +|+|++++-||.+|++|+.||+ |.|||+
T Consensus 229 e~~~y-iGt~~G~I~~~~~~~~~~~~~~v~~k~~~~~~t~~~~~~Gh~~~~~ITcLais~DgtlLlSGd~dg~-VcvWdi 306 (476)
T KOG0646|consen 229 ERVVY-IGTEEGKIFQNLLFKLSGQSAGVNQKGRHEENTQINVLVGHENESAITCLAISTDGTLLLSGDEDGK-VCVWDI 306 (476)
T ss_pred ccEEE-ecCCcceEEeeehhcCCcccccccccccccccceeeeeccccCCcceeEEEEecCccEEEeeCCCCC-EEEEec
Confidence 45544 399999999854321 13447889998 9999999999999999999999 999999
Q ss_pred CCCcEEEEEe
Q 020784 289 LDGTLLQEEC 298 (321)
Q Consensus 289 ~tg~~i~~~~ 298 (321)
.+.+|++++.
T Consensus 307 ~S~Q~iRtl~ 316 (476)
T KOG0646|consen 307 YSKQCIRTLQ 316 (476)
T ss_pred chHHHHHHHh
Confidence 9999998875
No 84
>KOG0313 consensus Microtubule binding protein YTM1 (contains WD40 repeats) [Cytoskeleton]
Probab=99.83 E-value=5e-19 Score=155.36 Aligned_cols=195 Identities=11% Similarity=0.144 Sum_probs=151.7
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecC-----Cce--------------------eEEeeeecCCceEEEEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDP-----FRE--------------------IFRRDFERGGGIGVVEM 135 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~-----~~~--------------------~~~~~~~~~~~v~~v~~ 135 (321)
++|+..|.||+..++|..+++|+-|. +.||+... .+. +..... |...|..|.|
T Consensus 190 ~GHk~~V~sVsv~~sgtr~~SgS~D~~lkiWs~~~~~~~~~E~~s~~rrk~~~~~~~~~~r~P~vtl~G-Ht~~Vs~V~w 268 (423)
T KOG0313|consen 190 RGHKRSVDSVSVDSSGTRFCSGSWDTMLKIWSVETDEEDELESSSNRRRKKQKREKEGGTRTPLVTLEG-HTEPVSSVVW 268 (423)
T ss_pred cccccceeEEEecCCCCeEEeecccceeeecccCCCccccccccchhhhhhhhhhhcccccCceEEecc-cccceeeEEE
Confidence 48999999999999999999999765 78999321 100 111111 6677888887
Q ss_pred ecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCe-EEEE--ECCEEEEEEcCCc---EEEEE
Q 020784 136 LFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDR-IIVV--LEQKIFVYNFADL---KLLHQ 209 (321)
Q Consensus 136 ~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~-~~~~--~~~~I~iwd~~~~---~~~~~ 209 (321)
+. ...+..++ .|++||.||+.+++++.++.......++..++.. ++++ ++..||+||.+++ -..++
T Consensus 269 ~d-~~v~yS~S-------wDHTIk~WDletg~~~~~~~~~ksl~~i~~~~~~~Ll~~gssdr~irl~DPR~~~gs~v~~s 340 (423)
T KOG0313|consen 269 SD-ATVIYSVS-------WDHTIKVWDLETGGLKSTLTTNKSLNCISYSPLSKLLASGSSDRHIRLWDPRTGDGSVVSQS 340 (423)
T ss_pred cC-CCceEeec-------ccceEEEEEeecccceeeeecCcceeEeecccccceeeecCCCCceeecCCCCCCCceeEEe
Confidence 65 33444445 6899999999999999999999999999998753 3333 3569999999753 23457
Q ss_pred EeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCC--cceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEE
Q 020784 210 IETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYAS--KRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 210 l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~--~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd 287 (321)
|.+|.+.+..+..++.. .++.+||+.||++++||.+. .++..+.+|...|.++.|+ +|.+++||+.|++ |||+.
T Consensus 341 ~~gH~nwVssvkwsp~~--~~~~~S~S~D~t~klWDvRS~k~plydI~~h~DKvl~vdW~-~~~~IvSGGaD~~-l~i~~ 416 (423)
T KOG0313|consen 341 LIGHKNWVSSVKWSPTN--EFQLVSGSYDNTVKLWDVRSTKAPLYDIAGHNDKVLSVDWN-EGGLIVSGGADNK-LRIFK 416 (423)
T ss_pred eecchhhhhheecCCCC--ceEEEEEecCCeEEEEEeccCCCcceeeccCCceEEEEecc-CCceEEeccCcce-EEEec
Confidence 88898888777777654 44445899999999999875 3688999999999999998 4778999999999 99986
Q ss_pred cC
Q 020784 288 TL 289 (321)
Q Consensus 288 ~~ 289 (321)
-.
T Consensus 417 ~~ 418 (423)
T KOG0313|consen 417 GS 418 (423)
T ss_pred cc
Confidence 44
No 85
>PTZ00420 coronin; Provisional
Probab=99.83 E-value=7e-18 Score=162.14 Aligned_cols=198 Identities=11% Similarity=0.063 Sum_probs=138.6
Q ss_pred EEEEEecCCceeEEeeeecCCceEEEEEecC-CCeEEEEeCCCCCCCCCCcEEEEeCCCCc--------EEEEEe-eCCc
Q 020784 108 FRIYNCDPFREIFRRDFERGGGIGVVEMLFR-CNILALVGGGPDPQYPLNKVMIWDDHQSR--------CIGELS-FRSE 177 (321)
Q Consensus 108 v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~-~~~~~~~sg~~~~~~~d~~v~iWD~~~~~--------~~~~~~-~~~~ 177 (321)
+++|+......+..... |.+.|..++|++. ++.+++++ .|++|+|||+.++. .+..+. +...
T Consensus 56 I~L~~~~r~~~v~~L~g-H~~~V~~lafsP~~~~lLASgS-------~DgtIrIWDi~t~~~~~~~i~~p~~~L~gH~~~ 127 (568)
T PTZ00420 56 IRLENQMRKPPVIKLKG-HTSSILDLQFNPCFSEILASGS-------EDLTIRVWEIPHNDESVKEIKDPQCILKGHKKK 127 (568)
T ss_pred EEeeecCCCceEEEEcC-CCCCEEEEEEcCCCCCEEEEEe-------CCCeEEEEECCCCCccccccccceEEeecCCCc
Confidence 67998776554444443 6788999999886 67777776 68999999997642 122333 3357
Q ss_pred eeEEEEeCCe--E-EEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eE
Q 020784 178 VRSVKLRRDR--I-IVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TK 252 (321)
Q Consensus 178 v~~v~~~~~~--~-~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~ 252 (321)
|.+++|++.. + +.+ .+++|++||+++++.+..+..+ . .+.++++++++.+|++ ++.|+.|+|||...+. +.
T Consensus 128 V~sVaf~P~g~~iLaSgS~DgtIrIWDl~tg~~~~~i~~~-~--~V~SlswspdG~lLat-~s~D~~IrIwD~Rsg~~i~ 203 (568)
T PTZ00420 128 ISIIDWNPMNYYIMCSSGFDSFVNIWDIENEKRAFQINMP-K--KLSSLKWNIKGNLLSG-TCVGKHMHIIDPRKQEIAS 203 (568)
T ss_pred EEEEEECCCCCeEEEEEeCCCeEEEEECCCCcEEEEEecC-C--cEEEEEECCCCCEEEE-EecCCEEEEEECCCCcEEE
Confidence 9999999853 3 333 3679999999998887777532 3 3555566667788884 7889999999998765 56
Q ss_pred EeeccccceeE-----EEECCCCCEEEEEeCCC----cEEEEEEcCC-CcEEEEEeCCCcceeE--EE-eecCceEEEe
Q 020784 253 FIMAHDSRIAC-----FALTQDGQLLATSSTKG----TLVRIFNTLD-GTLLQEECCPSISAQS--GL-WLSSAWLRVL 318 (321)
Q Consensus 253 ~l~~H~~~V~~-----vafspdg~~las~S~Dg----t~IrIWd~~t-g~~i~~~~~g~~~~~~--~~-s~d~~~la~~ 318 (321)
++.+|.+.+.+ ..|++++.+|+|++.|+ + |+|||+++ ++.+..+........+ .+ ..+|.+++++
T Consensus 204 tl~gH~g~~~s~~v~~~~fs~d~~~IlTtG~d~~~~R~-VkLWDlr~~~~pl~~~~ld~~~~~L~p~~D~~tg~l~lsG 281 (568)
T PTZ00420 204 SFHIHDGGKNTKNIWIDGLGGDDNYILSTGFSKNNMRE-MKLWDLKNTTSALVTMSIDNASAPLIPHYDESTGLIYLIG 281 (568)
T ss_pred EEecccCCceeEEEEeeeEcCCCCEEEEEEcCCCCccE-EEEEECCCCCCceEEEEecCCccceEEeeeCCCCCEEEEE
Confidence 88999876543 34568999999988775 6 99999995 6667665433322232 22 2346666654
No 86
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=99.83 E-value=1.7e-18 Score=151.38 Aligned_cols=225 Identities=11% Similarity=0.098 Sum_probs=169.7
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
...|...|.+|+.+|+.+++|+|+.|. ..||+..++........ |+..|.++.|++++.++|+.. -+|.|+
T Consensus 60 F~~H~~svFavsl~P~~~l~aTGGgDD~AflW~~~~ge~~~eltg-HKDSVt~~~FshdgtlLATGd-------msG~v~ 131 (399)
T KOG0296|consen 60 FDKHTDSVFAVSLHPNNNLVATGGGDDLAFLWDISTGEFAGELTG-HKDSVTCCSFSHDGTLLATGD-------MSGKVL 131 (399)
T ss_pred hhhcCCceEEEEeCCCCceEEecCCCceEEEEEccCCcceeEecC-CCCceEEEEEccCceEEEecC-------CCccEE
Confidence 457889999999999999999999855 55999999987766665 788999999999998888776 679999
Q ss_pred EEeCCCCcEEEEEeeC-CceeEEEEeCCe--EEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeec
Q 020784 160 IWDDHQSRCIGELSFR-SEVRSVKLRRDR--IIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPG 235 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~-~~v~~v~~~~~~--~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sG 235 (321)
||+..++.....+... ..+-=+.||+.. ++++ .++.+-+|.+.++...+.+.+|..+..+-.|.++ |+.++ .|
T Consensus 132 v~~~stg~~~~~~~~e~~dieWl~WHp~a~illAG~~DGsvWmw~ip~~~~~kv~~Gh~~~ct~G~f~pd--GKr~~-tg 208 (399)
T KOG0296|consen 132 VFKVSTGGEQWKLDQEVEDIEWLKWHPRAHILLAGSTDGSVWMWQIPSQALCKVMSGHNSPCTCGEFIPD--GKRIL-TG 208 (399)
T ss_pred EEEcccCceEEEeecccCceEEEEecccccEEEeecCCCcEEEEECCCcceeeEecCCCCCcccccccCC--CceEE-EE
Confidence 9999999887776533 356678889864 2333 3579999999988888899998888777777776 46676 48
Q ss_pred CCCCcEEEEeeCCcc-eEEe-------------------------------------------e--------ccccceeE
Q 020784 236 LQKGQVRVEHYASKR-TKFI-------------------------------------------M--------AHDSRIAC 263 (321)
Q Consensus 236 s~dg~V~i~d~~~~~-~~~l-------------------------------------------~--------~H~~~V~~ 263 (321)
..||+|++|+..+.. +..+ . .|...+.|
T Consensus 209 y~dgti~~Wn~ktg~p~~~~~~~e~~~~~~~~~~~~~~~~~~g~~e~~~~~~~~~sgKVv~~~n~~~~~l~~~~e~~~es 288 (399)
T KOG0296|consen 209 YDDGTIIVWNPKTGQPLHKITQAEGLELPCISLNLAGSTLTKGNSEGVACGVNNGSGKVVNCNNGTVPELKPSQEELDES 288 (399)
T ss_pred ecCceEEEEecCCCceeEEecccccCcCCccccccccceeEeccCCccEEEEccccceEEEecCCCCccccccchhhhhh
Confidence 999999999965431 1111 1 22333344
Q ss_pred EEE---CCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecC-ceEEEee
Q 020784 264 FAL---TQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSS-AWLRVLR 319 (321)
Q Consensus 264 vaf---spdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~-~~la~~~ 319 (321)
|.| +..-.++|+|+.||+ |-|||+.+.++.+.+ .|...++.+-|.+ .||+.|.
T Consensus 289 ve~~~~ss~lpL~A~G~vdG~-i~iyD~a~~~~R~~c--~he~~V~~l~w~~t~~l~t~c 345 (399)
T KOG0296|consen 289 VESIPSSSKLPLAACGSVDGT-IAIYDLAASTLRHIC--EHEDGVTKLKWLNTDYLLTAC 345 (399)
T ss_pred hhhcccccccchhhcccccce-EEEEecccchhheec--cCCCceEEEEEcCcchheeec
Confidence 444 445578899999999 999999998877666 3455566666666 7766653
No 87
>KOG0277 consensus Peroxisomal targeting signal type 2 receptor [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.82 E-value=1.1e-18 Score=146.15 Aligned_cols=220 Identities=16% Similarity=0.117 Sum_probs=154.9
Q ss_pred EEEEEcC--CCCE-EEEEcC------CcEEEEEec-CCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcE
Q 020784 89 LHISFNQ--DHGC-FAAGTD------HGFRIYNCD-PFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 89 ~~v~fs~--dg~~-lasg~~------~gv~vw~~~-~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
+++.||| ++++ +|++.. +.+.|-+.. ..+......+.....+..|+|+.....++++..| ||.+
T Consensus 12 ysvqfSPf~~nrLavAt~q~yGl~G~G~L~ile~~~~~gi~e~~s~d~~D~LfdV~Wse~~e~~~~~a~G------DGSL 85 (311)
T KOG0277|consen 12 YSVQFSPFVENRLAVATAQHYGLAGNGRLFILEVTDPKGIQECQSYDTEDGLFDVAWSENHENQVIAASG------DGSL 85 (311)
T ss_pred ceeEecccccchhheeehhhcccccCceEEEEecCCCCCeEEEEeeecccceeEeeecCCCcceEEEEec------CceE
Confidence 5688888 3443 233332 224566764 4443333444346778888998765444443332 6999
Q ss_pred EEEeCCCC-cEEEEEeeC-CceeEEEEeCC---e-EEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEE
Q 020784 159 MIWDDHQS-RCIGELSFR-SEVRSVKLRRD---R-IIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLV 232 (321)
Q Consensus 159 ~iWD~~~~-~~~~~~~~~-~~v~~v~~~~~---~-~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la 232 (321)
+|||+... ..+..++.+ .+|.++.|+.. . +....|++|++|+....+.+++|.+|..-+....++|... .+++
T Consensus 86 rl~d~~~~s~Pi~~~kEH~~EV~Svdwn~~~r~~~ltsSWD~TiKLW~~~r~~Sv~Tf~gh~~~Iy~a~~sp~~~-nlfa 164 (311)
T KOG0277|consen 86 RLFDLTMPSKPIHKFKEHKREVYSVDWNTVRRRIFLTSSWDGTIKLWDPNRPNSVQTFNGHNSCIYQAAFSPHIP-NLFA 164 (311)
T ss_pred EEeccCCCCcchhHHHhhhhheEEeccccccceeEEeeccCCceEeecCCCCcceEeecCCccEEEEEecCCCCC-CeEE
Confidence 99996543 345555544 48999999853 2 3333578999999999999999999988888888888754 4556
Q ss_pred eecCCCCcEEEEeeCC-cceEEeeccccceeEEEEC-CCCCEEEEEeCCCcEEEEEEcCCCc-EEEEEeCCCcceeEEEe
Q 020784 233 CPGLQKGQVRVEHYAS-KRTKFIMAHDSRIACFALT-QDGQLLATSSTKGTLVRIFNTLDGT-LLQEECCPSISAQSGLW 309 (321)
Q Consensus 233 ~sGs~dg~V~i~d~~~-~~~~~l~~H~~~V~~vafs-pdg~~las~S~Dgt~IrIWd~~tg~-~i~~~~~g~~~~~~~~s 309 (321)
+.+.||.+++||+.. +....+.+|...+.|+.|+ -+...||||+.|+. ||+||++..+ .+.++ .||.-++..+.
T Consensus 165 -s~Sgd~~l~lwdvr~~gk~~~i~ah~~Eil~cdw~ky~~~vl~Tg~vd~~-vr~wDir~~r~pl~eL-~gh~~AVRkvk 241 (311)
T KOG0277|consen 165 -SASGDGTLRLWDVRSPGKFMSIEAHNSEILCCDWSKYNHNVLATGGVDNL-VRGWDIRNLRTPLFEL-NGHGLAVRKVK 241 (311)
T ss_pred -EccCCceEEEEEecCCCceeEEEeccceeEeecccccCCcEEEecCCCce-EEEEehhhccccceee-cCCceEEEEEe
Confidence 589999999999875 4455699999999999999 57789999999999 9999999854 46666 57776655444
Q ss_pred ecC---ceEEEe
Q 020784 310 LSS---AWLRVL 318 (321)
Q Consensus 310 ~d~---~~la~~ 318 (321)
+++ ..||.|
T Consensus 242 ~Sph~~~lLaSa 253 (311)
T KOG0277|consen 242 FSPHHASLLASA 253 (311)
T ss_pred cCcchhhHhhhc
Confidence 444 444443
No 88
>KOG0313 consensus Microtubule binding protein YTM1 (contains WD40 repeats) [Cytoskeleton]
Probab=99.82 E-value=2.4e-18 Score=151.10 Aligned_cols=224 Identities=13% Similarity=0.103 Sum_probs=161.5
Q ss_pred cCCCCCCeEEEEEcC-CC--CEEEEEcC-CcEEEEEecCCceeEEeee---ecCCceEEEEEecCCCeEEEEeCCCCCCC
Q 020784 81 SSSPPPTLLHISFNQ-DH--GCFAAGTD-HGFRIYNCDPFREIFRRDF---ERGGGIGVVEMLFRCNILALVGGGPDPQY 153 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~-dg--~~lasg~~-~gv~vw~~~~~~~~~~~~~---~~~~~v~~v~~~~~~~~~~~~sg~~~~~~ 153 (321)
..+|.++|.+++|-- |. ..|++++. .++++|..+.+........ .|...|.+|....++..++.++
T Consensus 140 ~~Ght~~ik~v~~v~~n~~~~~fvsas~Dqtl~Lw~~~~~~~~~~~~~~~~GHk~~V~sVsv~~sgtr~~SgS------- 212 (423)
T KOG0313|consen 140 IVGHTGPIKSVAWVIKNSSSCLFVSASMDQTLRLWKWNVGENKVKALKVCRGHKRSVDSVSVDSSGTRFCSGS------- 212 (423)
T ss_pred EecCCcceeeeEEEecCCccceEEEecCCceEEEEEecCchhhhhHHhHhcccccceeEEEecCCCCeEEeec-------
Confidence 357888999888753 32 24777776 6688998876543221111 2788899999888888777766
Q ss_pred CCCcEEEEeCCCC-------------------------cEEEEEeeC-CceeEEEEeCCe-EEEE-ECCEEEEEEcCCcE
Q 020784 154 PLNKVMIWDDHQS-------------------------RCIGELSFR-SEVRSVKLRRDR-IIVV-LEQKIFVYNFADLK 205 (321)
Q Consensus 154 ~d~~v~iWD~~~~-------------------------~~~~~~~~~-~~v~~v~~~~~~-~~~~-~~~~I~iwd~~~~~ 205 (321)
.|.+|+||+..+. ..+.++..| ..|.+|.|.... ++.+ .|.+|+.||+.+++
T Consensus 213 ~D~~lkiWs~~~~~~~~~E~~s~~rrk~~~~~~~~~~r~P~vtl~GHt~~Vs~V~w~d~~v~yS~SwDHTIk~WDletg~ 292 (423)
T KOG0313|consen 213 WDTMLKIWSVETDEEDELESSSNRRRKKQKREKEGGTRTPLVTLEGHTEPVSSVVWSDATVIYSVSWDHTIKVWDLETGG 292 (423)
T ss_pred ccceeeecccCCCccccccccchhhhhhhhhhhcccccCceEEecccccceeeEEEcCCCceEeecccceEEEEEeeccc
Confidence 6899999992211 112223333 478889987643 3334 46799999999999
Q ss_pred EEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc----eEEeeccccceeEEEECCC-CCEEEEEeCCC
Q 020784 206 LLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR----TKFIMAHDSRIACFALTQD-GQLLATSSTKG 280 (321)
Q Consensus 206 ~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~----~~~l~~H~~~V~~vafspd-g~~las~S~Dg 280 (321)
++.++.+. ....+++..+...+|| +|+.|..+++||-+.+. ..+|.+|++-|.+|.|+|. ..+|++||.|+
T Consensus 293 ~~~~~~~~---ksl~~i~~~~~~~Ll~-~gssdr~irl~DPR~~~gs~v~~s~~gH~nwVssvkwsp~~~~~~~S~S~D~ 368 (423)
T KOG0313|consen 293 LKSTLTTN---KSLNCISYSPLSKLLA-SGSSDRHIRLWDPRTGDGSVVSQSLIGHKNWVSSVKWSPTNEFQLVSGSYDN 368 (423)
T ss_pred ceeeeecC---cceeEeecccccceee-ecCCCCceeecCCCCCCCceeEEeeecchhhhhheecCCCCceEEEEEecCC
Confidence 88887764 2355566666778888 59999999999977542 3478999999999999986 46799999999
Q ss_pred cEEEEEEcCCCc-EEEEEeCCCcceeEEEee-cCceEEE
Q 020784 281 TLVRIFNTLDGT-LLQEECCPSISAQSGLWL-SSAWLRV 317 (321)
Q Consensus 281 t~IrIWd~~tg~-~i~~~~~g~~~~~~~~s~-d~~~la~ 317 (321)
+ +|+||+++-+ .++.+ .+|....++.-| .+.+|+.
T Consensus 369 t-~klWDvRS~k~plydI-~~h~DKvl~vdW~~~~~IvS 405 (423)
T KOG0313|consen 369 T-VKLWDVRSTKAPLYDI-AGHNDKVLSVDWNEGGLIVS 405 (423)
T ss_pred e-EEEEEeccCCCcceee-ccCCceEEEEeccCCceEEe
Confidence 9 9999999988 78888 466666666654 4445544
No 89
>KOG0305 consensus Anaphase promoting complex, Cdc20, Cdh1, and Ama1 subunits [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=99.82 E-value=1.3e-18 Score=161.75 Aligned_cols=211 Identities=15% Similarity=0.081 Sum_probs=172.4
Q ss_pred EEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcE
Q 020784 89 LHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRC 168 (321)
Q Consensus 89 ~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~ 168 (321)
+-+.|+ ....||+|....|.+|+..++.....-.+ +...+..+.|++++..+++.. .+|.|.|||..+.+.
T Consensus 181 nlldWs-s~n~laValg~~vylW~~~s~~v~~l~~~-~~~~vtSv~ws~~G~~LavG~-------~~g~v~iwD~~~~k~ 251 (484)
T KOG0305|consen 181 NLLDWS-SANVLAVALGQSVYLWSASSGSVTELCSF-GEELVTSVKWSPDGSHLAVGT-------SDGTVQIWDVKEQKK 251 (484)
T ss_pred hHhhcc-cCCeEEEEecceEEEEecCCCceEEeEec-CCCceEEEEECCCCCEEEEee-------cCCeEEEEehhhccc
Confidence 346677 45579999999999999988875544444 367899999999999999988 679999999998888
Q ss_pred EEEEee--CCceeEEEEeCCeEEEEE-CCEEEEEEcCCcEEEEE-EeccCCCCceEEEeeCCCceEEEeecCCCCcEEEE
Q 020784 169 IGELSF--RSEVRSVKLRRDRIIVVL-EQKIFVYNFADLKLLHQ-IETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVE 244 (321)
Q Consensus 169 ~~~~~~--~~~v~~v~~~~~~~~~~~-~~~I~iwd~~~~~~~~~-l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~ 244 (321)
+.++.. ...|.+++|+...+..+. ++.|..+|++..+.... +.+|.+ .+|.+....|+..+| ||+.|+.+.||
T Consensus 252 ~~~~~~~h~~rvg~laW~~~~lssGsr~~~I~~~dvR~~~~~~~~~~~H~q--eVCgLkws~d~~~lA-SGgnDN~~~Iw 328 (484)
T KOG0305|consen 252 TRTLRGSHASRVGSLAWNSSVLSSGSRDGKILNHDVRISQHVVSTLQGHRQ--EVCGLKWSPDGNQLA-SGGNDNVVFIW 328 (484)
T ss_pred cccccCCcCceeEEEeccCceEEEecCCCcEEEEEEecchhhhhhhhcccc--eeeeeEECCCCCeec-cCCCccceEec
Confidence 888776 458999999977776665 46999999987665544 555554 477777788889999 79999999999
Q ss_pred eeCC-cceEEeeccccceeEEEECCC-CCEEEEE--eCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecC
Q 020784 245 HYAS-KRTKFIMAHDSRIACFALTQD-GQLLATS--STKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSS 312 (321)
Q Consensus 245 d~~~-~~~~~l~~H~~~V~~vafspd-g~~las~--S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~ 312 (321)
|... .+...+..|..+|..++|+|- ..+||+| +.|++ ||+||+.+|++++....+...+.+..+...
T Consensus 329 d~~~~~p~~~~~~H~aAVKA~awcP~q~~lLAsGGGs~D~~-i~fwn~~~g~~i~~vdtgsQVcsL~Wsk~~ 399 (484)
T KOG0305|consen 329 DGLSPEPKFTFTEHTAAVKALAWCPWQSGLLATGGGSADRC-IKFWNTNTGARIDSVDTGSQVCSLIWSKKY 399 (484)
T ss_pred cCCCccccEEEeccceeeeEeeeCCCccCceEEcCCCcccE-EEEEEcCCCcEecccccCCceeeEEEcCCC
Confidence 9854 457799999999999999985 6789996 56998 999999999999999888887777666555
No 90
>KOG1273 consensus WD40 repeat protein [General function prediction only]
Probab=99.81 E-value=7.3e-18 Score=145.06 Aligned_cols=203 Identities=16% Similarity=0.145 Sum_probs=157.1
Q ss_pred eEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCC
Q 020784 88 LLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQS 166 (321)
Q Consensus 88 V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~ 166 (321)
-.||.|++.|.+||.|..+| |.|||+.+.+.-..... |-.+|.+++|+.++..+.+++ .|..|++||+..|
T Consensus 26 a~~~~Fs~~G~~lAvGc~nG~vvI~D~~T~~iar~lsa-H~~pi~sl~WS~dgr~LltsS-------~D~si~lwDl~~g 97 (405)
T KOG1273|consen 26 AECCQFSRWGDYLAVGCANGRVVIYDFDTFRIARMLSA-HVRPITSLCWSRDGRKLLTSS-------RDWSIKLWDLLKG 97 (405)
T ss_pred cceEEeccCcceeeeeccCCcEEEEEccccchhhhhhc-cccceeEEEecCCCCEeeeec-------CCceeEEEeccCC
Confidence 78999999999999999877 77999999875444443 678999999999999999988 7899999999999
Q ss_pred cEEEEEeeCCceeEEEEeCC-------------------------------------------------eEEEEEC-CEE
Q 020784 167 RCIGELSFRSEVRSVKLRRD-------------------------------------------------RIIVVLE-QKI 196 (321)
Q Consensus 167 ~~~~~~~~~~~v~~v~~~~~-------------------------------------------------~~~~~~~-~~I 196 (321)
.++..+.+.++|..+.||+. .+++++. |.+
T Consensus 98 s~l~rirf~spv~~~q~hp~k~n~~va~~~~~sp~vi~~s~~~h~~Lp~d~d~dln~sas~~~fdr~g~yIitGtsKGkl 177 (405)
T KOG1273|consen 98 SPLKRIRFDSPVWGAQWHPRKRNKCVATIMEESPVVIDFSDPKHSVLPKDDDGDLNSSASHGVFDRRGKYIITGTSKGKL 177 (405)
T ss_pred CceeEEEccCccceeeeccccCCeEEEEEecCCcEEEEecCCceeeccCCCccccccccccccccCCCCEEEEecCcceE
Confidence 99999999988888877753 2334433 589
Q ss_pred EEEEcCCcEEEEEEeccC-CCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCc----c--eEE-eecc-----ccceeE
Q 020784 197 FVYNFADLKLLHQIETIA-NPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASK----R--TKF-IMAH-----DSRIAC 263 (321)
Q Consensus 197 ~iwd~~~~~~~~~l~~~~-~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~----~--~~~-l~~H-----~~~V~~ 263 (321)
.+||..+.+++..++-.. ..+..+-++..+ ..+++ .+.|..||.++.+.- . ..+ .... +-.=.+
T Consensus 178 lv~~a~t~e~vas~rits~~~IK~I~~s~~g--~~lii-NtsDRvIR~ye~~di~~~~r~~e~e~~~K~qDvVNk~~Wk~ 254 (405)
T KOG1273|consen 178 LVYDAETLECVASFRITSVQAIKQIIVSRKG--RFLII-NTSDRVIRTYEISDIDDEGRDGEVEPEHKLQDVVNKLQWKK 254 (405)
T ss_pred EEEecchheeeeeeeechheeeeEEEEeccC--cEEEE-ecCCceEEEEehhhhcccCccCCcChhHHHHHHHhhhhhhh
Confidence 999999999888886544 445566666665 55554 788999999886521 0 011 0111 123368
Q ss_pred EEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCc
Q 020784 264 FALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSI 302 (321)
Q Consensus 264 vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~ 302 (321)
++||.+|.|++.++.-...+.||....|.+++-+. |..
T Consensus 255 ccfs~dgeYv~a~s~~aHaLYIWE~~~GsLVKILh-G~k 292 (405)
T KOG1273|consen 255 CCFSGDGEYVCAGSARAHALYIWEKSIGSLVKILH-GTK 292 (405)
T ss_pred eeecCCccEEEeccccceeEEEEecCCcceeeeec-CCc
Confidence 99999999999888777779999999999999884 444
No 91
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=99.80 E-value=1.3e-16 Score=142.64 Aligned_cols=220 Identities=14% Similarity=0.107 Sum_probs=154.3
Q ss_pred CeEEEEEcCCCCEE-EEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC
Q 020784 87 TLLHISFNQDHGCF-AAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH 164 (321)
Q Consensus 87 ~V~~v~fs~dg~~l-asg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~ 164 (321)
.+.+++|++||+.+ ++++. +.+++||..+++....... ......+.++++++.++++++ .++.|++||++
T Consensus 32 ~~~~l~~~~dg~~l~~~~~~~~~v~~~d~~~~~~~~~~~~--~~~~~~~~~~~~g~~l~~~~~------~~~~l~~~d~~ 103 (300)
T TIGR03866 32 RPRGITLSKDGKLLYVCASDSDTIQVIDLATGEVIGTLPS--GPDPELFALHPNGKILYIANE------DDNLVTVIDIE 103 (300)
T ss_pred CCCceEECCCCCEEEEEECCCCeEEEEECCCCcEEEeccC--CCCccEEEECCCCCEEEEEcC------CCCeEEEEECC
Confidence 46789999999876 56555 5588999988776543332 334556778888887766542 36899999999
Q ss_pred CCcEEEEEeeCCceeEEEEeCCe--EEEEEC--CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCc
Q 020784 165 QSRCIGELSFRSEVRSVKLRRDR--IIVVLE--QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQ 240 (321)
Q Consensus 165 ~~~~~~~~~~~~~v~~v~~~~~~--~~~~~~--~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~ 240 (321)
+++.+..+.....+.++.++++. ++++.. ..+.+||..+++.+..+.....+ ..++++ +++..+++++..+|.
T Consensus 104 ~~~~~~~~~~~~~~~~~~~~~dg~~l~~~~~~~~~~~~~d~~~~~~~~~~~~~~~~-~~~~~s--~dg~~l~~~~~~~~~ 180 (300)
T TIGR03866 104 TRKVLAEIPVGVEPEGMAVSPDGKIVVNTSETTNMAHFIDTKTYEIVDNVLVDQRP-RFAEFT--ADGKELWVSSEIGGT 180 (300)
T ss_pred CCeEEeEeeCCCCcceEEECCCCCEEEEEecCCCeEEEEeCCCCeEEEEEEcCCCc-cEEEEC--CCCCEEEEEcCCCCE
Confidence 98888777766667888998764 444433 36788899888776665433222 334444 455666555677899
Q ss_pred EEEEeeCCcce-EEeeccc-----c--ceeEEEECCCCCEEEE-EeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeec
Q 020784 241 VRVEHYASKRT-KFIMAHD-----S--RIACFALTQDGQLLAT-SSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLS 311 (321)
Q Consensus 241 V~i~d~~~~~~-~~l~~H~-----~--~V~~vafspdg~~las-~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d 311 (321)
|++||..+... ..+..+. . ....++|+|+|+++.. .+.+++ |.|||+++++++..+..++....+.++++
T Consensus 181 v~i~d~~~~~~~~~~~~~~~~~~~~~~~~~~i~~s~dg~~~~~~~~~~~~-i~v~d~~~~~~~~~~~~~~~~~~~~~~~~ 259 (300)
T TIGR03866 181 VSVIDVATRKVIKKITFEIPGVHPEAVQPVGIKLTKDGKTAFVALGPANR-VAVVDAKTYEVLDYLLVGQRVWQLAFTPD 259 (300)
T ss_pred EEEEEcCcceeeeeeeecccccccccCCccceEECCCCCEEEEEcCCCCe-EEEEECCCCcEEEEEEeCCCcceEEECCC
Confidence 99999987653 3443221 1 2457899999997544 455667 99999999999877766666666788899
Q ss_pred CceEEEe
Q 020784 312 SAWLRVL 318 (321)
Q Consensus 312 ~~~la~~ 318 (321)
|++|+++
T Consensus 260 g~~l~~~ 266 (300)
T TIGR03866 260 EKYLLTT 266 (300)
T ss_pred CCEEEEE
Confidence 9998764
No 92
>KOG1408 consensus WD40 repeat protein [Function unknown]
Probab=99.80 E-value=1.5e-18 Score=162.83 Aligned_cols=198 Identities=15% Similarity=0.196 Sum_probs=156.1
Q ss_pred CCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecC---CCeEEEEeCCCCCCCCCCcE
Q 020784 83 SPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFR---CNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~---~~~~~~~sg~~~~~~~d~~v 158 (321)
..+..|+|++++|||++||+|...| +|||++...+.....+. |+..|.++++++. ..++|.++ .|+-|
T Consensus 457 d~r~G~R~~~vSp~gqhLAsGDr~GnlrVy~Lq~l~~~~~~eA-HesEilcLeyS~p~~~~kLLASas-------rdRlI 528 (1080)
T KOG1408|consen 457 DSRFGFRALAVSPDGQHLASGDRGGNLRVYDLQELEYTCFMEA-HESEILCLEYSFPVLTNKLLASAS-------RDRLI 528 (1080)
T ss_pred CcccceEEEEECCCcceecccCccCceEEEEehhhhhhhheec-ccceeEEEeecCchhhhHhhhhcc-------CCceE
Confidence 4556899999999999999999854 99999998887766666 7889999999774 23445444 57899
Q ss_pred EEEeCCC-CcEEEEEeeC-CceeEEEEeCC--------------------------------------------------
Q 020784 159 MIWDDHQ-SRCIGELSFR-SEVRSVKLRRD-------------------------------------------------- 186 (321)
Q Consensus 159 ~iWD~~~-~~~~~~~~~~-~~v~~v~~~~~-------------------------------------------------- 186 (321)
.|+|+.. ...+.++..+ ..|++|.|-..
T Consensus 529 HV~Dv~rny~l~qtld~HSssITsvKFa~~gln~~MiscGADksimFr~~qk~~~g~~f~r~t~t~~ktTlYDm~Vdp~~ 608 (1080)
T KOG1408|consen 529 HVYDVKRNYDLVQTLDGHSSSITSVKFACNGLNRKMISCGADKSIMFRVNQKASSGRLFPRHTQTLSKTTLYDMAVDPTS 608 (1080)
T ss_pred EEEecccccchhhhhcccccceeEEEEeecCCceEEEeccCchhhheehhccccCceeccccccccccceEEEeeeCCCc
Confidence 9999764 3344454433 34555554211
Q ss_pred --eEEEEECCEEEEEEcCCcEEEEEEeccCC-CCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeecccccee
Q 020784 187 --RIIVVLEQKIFVYNFADLKLLHQIETIAN-PKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIA 262 (321)
Q Consensus 187 --~~~~~~~~~I~iwd~~~~~~~~~l~~~~~-~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~ 262 (321)
.+.+|.|..|||||+.+++.++.|++... ....+-+..+|.+.++|+ ...|+++.++|+..+. +.+..||...|+
T Consensus 609 k~v~t~cQDrnirif~i~sgKq~k~FKgs~~~eG~lIKv~lDPSgiY~at-Scsdktl~~~Df~sgEcvA~m~GHsE~VT 687 (1080)
T KOG1408|consen 609 KLVVTVCQDRNIRIFDIESGKQVKSFKGSRDHEGDLIKVILDPSGIYLAT-SCSDKTLCFVDFVSGECVAQMTGHSEAVT 687 (1080)
T ss_pred ceEEEEecccceEEEeccccceeeeecccccCCCceEEEEECCCccEEEE-eecCCceEEEEeccchhhhhhcCcchhee
Confidence 23445678999999999999999988443 456778888999999996 5668899999987765 568999999999
Q ss_pred EEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 263 CFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 263 ~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
.+.|.+|.++|++.|.||. |-||.+..
T Consensus 688 G~kF~nDCkHlISvsgDgC-IFvW~lp~ 714 (1080)
T KOG1408|consen 688 GVKFLNDCKHLISVSGDGC-IFVWKLPL 714 (1080)
T ss_pred eeeecccchhheeecCCce-EEEEECch
Confidence 9999999999999999999 99999875
No 93
>KOG0288 consensus WD40 repeat protein TipD [General function prediction only]
Probab=99.80 E-value=5.5e-19 Score=156.53 Aligned_cols=223 Identities=13% Similarity=0.166 Sum_probs=171.1
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCC-cEEEEEecCCceeEEeeee-cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDH-GFRIYNCDPFREIFRRDFE-RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~-gv~vw~~~~~~~~~~~~~~-~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
..|.+.|..+.|-++...|++|+.+ -|++|++...+......+. ..+.+..+++..++..++.++ +|++++
T Consensus 172 d~h~gev~~v~~l~~sdtlatgg~Dr~Ik~W~v~~~k~~~~~tLaGs~g~it~~d~d~~~~~~iAas-------~d~~~r 244 (459)
T KOG0288|consen 172 DAHEGEVHDVEFLRNSDTLATGGSDRIIKLWNVLGEKSELISTLAGSLGNITSIDFDSDNKHVIAAS-------NDKNLR 244 (459)
T ss_pred hccccccceeEEccCcchhhhcchhhhhhhhhcccchhhhhhhhhccCCCcceeeecCCCceEEeec-------CCCcee
Confidence 5688899999999998889988875 5779999777643333331 245688888877777777666 789999
Q ss_pred EEeCCCCcEEEEEeeCC-ceeEEEEeCCeE-EEE-E-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeec
Q 020784 160 IWDDHQSRCIGELSFRS-EVRSVKLRRDRI-IVV-L-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPG 235 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~~-~v~~v~~~~~~~-~~~-~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sG 235 (321)
+||+...+...++..|. .|+++.|..... ++. . |.+|++||+.+..+.+++-.... +.++...+ ..++ ||
T Consensus 245 ~Wnvd~~r~~~TLsGHtdkVt~ak~~~~~~~vVsgs~DRtiK~WDl~k~~C~kt~l~~S~---cnDI~~~~--~~~~-Sg 318 (459)
T KOG0288|consen 245 LWNVDSLRLRHTLSGHTDKVTAAKFKLSHSRVVSGSADRTIKLWDLQKAYCSKTVLPGSQ---CNDIVCSI--SDVI-SG 318 (459)
T ss_pred eeeccchhhhhhhcccccceeeehhhccccceeeccccchhhhhhhhhhheecccccccc---ccceEecc--eeee-ec
Confidence 99999999988888765 799998876554 332 2 45999999999888777654332 22333321 3344 79
Q ss_pred CCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEe-----CCCcceeEEEe
Q 020784 236 LQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEEC-----CPSISAQSGLW 309 (321)
Q Consensus 236 s~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~-----~g~~~~~~~~s 309 (321)
..|++|+.||..... ......|. .|++|..+++|..|.+++.|++ +++.|+++.+..++|. .+++-....||
T Consensus 319 H~DkkvRfwD~Rs~~~~~sv~~gg-~vtSl~ls~~g~~lLsssRDdt-l~viDlRt~eI~~~~sA~g~k~asDwtrvvfS 396 (459)
T KOG0288|consen 319 HFDKKVRFWDIRSADKTRSVPLGG-RVTSLDLSMDGLELLSSSRDDT-LKVIDLRTKEIRQTFSAEGFKCASDWTRVVFS 396 (459)
T ss_pred ccccceEEEeccCCceeeEeecCc-ceeeEeeccCCeEEeeecCCCc-eeeeecccccEEEEeeccccccccccceeEEC
Confidence 999999999977655 44555555 8999999999999999999999 9999999998888764 45666677999
Q ss_pred ecCceEEEee
Q 020784 310 LSSAWLRVLR 319 (321)
Q Consensus 310 ~d~~~la~~~ 319 (321)
+++.|+|+-+
T Consensus 397 pd~~YvaAGS 406 (459)
T KOG0288|consen 397 PDGSYVAAGS 406 (459)
T ss_pred CCCceeeecc
Confidence 9999998754
No 94
>KOG0264 consensus Nucleosome remodeling factor, subunit CAF1/NURF55/MSI1 [Chromatin structure and dynamics]
Probab=99.79 E-value=6.2e-18 Score=151.45 Aligned_cols=221 Identities=12% Similarity=0.047 Sum_probs=156.5
Q ss_pred CCCCCCeEEEEEcCCCC-EEEEEcCCc-EEEEEecCCceeE----------EeeeecCCceEEEEEecCCCeEEEEeCCC
Q 020784 82 SSPPPTLLHISFNQDHG-CFAAGTDHG-FRIYNCDPFREIF----------RRDFERGGGIGVVEMLFRCNILALVGGGP 149 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~-~lasg~~~g-v~vw~~~~~~~~~----------~~~~~~~~~v~~v~~~~~~~~~~~~sg~~ 149 (321)
-.|.+.|+.++..|... ++|+++..+ +.|||.....-.. .... |.+.-..+.|........+.+ +
T Consensus 121 i~h~gEVnRaRymPQnp~iVAt~t~~~dv~Vfd~tk~~s~~~~~~~~~Pdl~L~g-H~~eg~glsWn~~~~g~Lls~-~- 197 (422)
T KOG0264|consen 121 INHDGEVNRARYMPQNPNIVATKTSSGDVYVFDYTKHPSKPKASGECRPDLRLKG-HEKEGYGLSWNRQQEGTLLSG-S- 197 (422)
T ss_pred ccCCccchhhhhCCCCCcEEEecCCCCCEEEEEeccCCCcccccccCCCceEEEe-ecccccccccccccceeEeec-c-
Confidence 46888999999999775 555666655 7899985432111 2222 455444566655444333333 2
Q ss_pred CCCCCCCcEEEEeCCCCcE-------EEEEeeC-CceeEEEEeCC---eEEEEEC-CEEEEEEcC--CcEEEEEEeccCC
Q 020784 150 DPQYPLNKVMIWDDHQSRC-------IGELSFR-SEVRSVKLRRD---RIIVVLE-QKIFVYNFA--DLKLLHQIETIAN 215 (321)
Q Consensus 150 ~~~~~d~~v~iWD~~~~~~-------~~~~~~~-~~v~~v~~~~~---~~~~~~~-~~I~iwd~~--~~~~~~~l~~~~~ 215 (321)
+|++|++||+..... ...+..+ ..|..++|++. .+..+++ +.+.|||+| +.+..+..+.|..
T Consensus 198 ----~d~~i~lwdi~~~~~~~~~~~p~~~~~~h~~~VeDV~~h~~h~~lF~sv~dd~~L~iwD~R~~~~~~~~~~~ah~~ 273 (422)
T KOG0264|consen 198 ----DDHTICLWDINAESKEDKVVDPKTIFSGHEDVVEDVAWHPLHEDLFGSVGDDGKLMIWDTRSNTSKPSHSVKAHSA 273 (422)
T ss_pred ----CCCcEEEEeccccccCCccccceEEeecCCcceehhhccccchhhheeecCCCeEEEEEcCCCCCCCcccccccCC
Confidence 679999999865332 1223333 36778888753 4555554 699999999 6666777788889
Q ss_pred CCceEEEeeCCCceEEEeecCCCCcEEEEeeCC--cceEEeeccccceeEEEECCC-CCEEEEEeCCCcEEEEEEcCCCc
Q 020784 216 PKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYAS--KRTKFIMAHDSRIACFALTQD-GQLLATSSTKGTLVRIFNTLDGT 292 (321)
Q Consensus 216 ~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~--~~~~~l~~H~~~V~~vafspd-g~~las~S~Dgt~IrIWd~~tg~ 292 (321)
++.+++|++.. ..+|| +|+.||+|.+||++. .+++++.+|...|.+|.|||+ ...|||++.|+. +.|||+..-.
T Consensus 274 ~vn~~~fnp~~-~~ilA-T~S~D~tV~LwDlRnL~~~lh~~e~H~dev~~V~WSPh~etvLASSg~D~r-l~vWDls~ig 350 (422)
T KOG0264|consen 274 EVNCVAFNPFN-EFILA-TGSADKTVALWDLRNLNKPLHTFEGHEDEVFQVEWSPHNETVLASSGTDRR-LNVWDLSRIG 350 (422)
T ss_pred ceeEEEeCCCC-CceEE-eccCCCcEEEeechhcccCceeccCCCcceEEEEeCCCCCceeEecccCCc-EEEEeccccc
Confidence 99999998875 46677 699999999999875 457899999999999999997 568999999999 9999998522
Q ss_pred EEE-------------EEeCCCcceeEEEeecC
Q 020784 293 LLQ-------------EECCPSISAQSGLWLSS 312 (321)
Q Consensus 293 ~i~-------------~~~~g~~~~~~~~s~d~ 312 (321)
..+ =...||...+.-|++++
T Consensus 351 ~eq~~eda~dgppEllF~HgGH~~kV~DfsWnp 383 (422)
T KOG0264|consen 351 EEQSPEDAEDGPPELLFIHGGHTAKVSDFSWNP 383 (422)
T ss_pred cccChhhhccCCcceeEEecCcccccccccCCC
Confidence 111 12357777777777776
No 95
>KOG0641 consensus WD40 repeat protein [General function prediction only]
Probab=99.79 E-value=1.5e-16 Score=131.34 Aligned_cols=221 Identities=16% Similarity=0.236 Sum_probs=162.0
Q ss_pred CCeEEEEEcCCCCEEEEEcC-CcEEEEEec--------------CCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCC
Q 020784 86 PTLLHISFNQDHGCFAAGTD-HGFRIYNCD--------------PFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPD 150 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~-~gv~vw~~~--------------~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~ 150 (321)
..|++|+|+|.|.+.|+|++ +++||--.. +....+.+.-.|.+.|.+++|++.+.++++.+
T Consensus 33 qairav~fhp~g~lyavgsnskt~ric~yp~l~~~r~~hea~~~pp~v~~kr~khhkgsiyc~~ws~~geliatgs---- 108 (350)
T KOG0641|consen 33 QAIRAVAFHPAGGLYAVGSNSKTFRICAYPALIDLRHAHEAAKQPPSVLCKRNKHHKGSIYCTAWSPCGELIATGS---- 108 (350)
T ss_pred hheeeEEecCCCceEEeccCCceEEEEccccccCcccccccccCCCeEEeeeccccCccEEEEEecCccCeEEecC----
Confidence 47999999999999999998 777776321 11233333333789999999999999998877
Q ss_pred CCCCCCcEEEEeCCCCcEE-----EEEe-eCCceeEEEEeCC-----e-EEEEE--CCEEEEEEcCCcEEEEEEeccCCC
Q 020784 151 PQYPLNKVMIWDDHQSRCI-----GELS-FRSEVRSVKLRRD-----R-IIVVL--EQKIFVYNFADLKLLHQIETIANP 216 (321)
Q Consensus 151 ~~~~d~~v~iWD~~~~~~~-----~~~~-~~~~v~~v~~~~~-----~-~~~~~--~~~I~iwd~~~~~~~~~l~~~~~~ 216 (321)
+|++||+.-++...+. .++. +.+.|..++|..+ . ++.+. +.+|.+=|...++-++.+.+|..-
T Consensus 109 ---ndk~ik~l~fn~dt~~~~g~dle~nmhdgtirdl~fld~~~s~~~il~s~gagdc~iy~tdc~~g~~~~a~sghtgh 185 (350)
T KOG0641|consen 109 ---NDKTIKVLPFNADTCNATGHDLEFNMHDGTIRDLAFLDDPESGGAILASAGAGDCKIYITDCGRGQGFHALSGHTGH 185 (350)
T ss_pred ---CCceEEEEecccccccccCcceeeeecCCceeeeEEecCCCcCceEEEecCCCcceEEEeecCCCCcceeecCCccc
Confidence 8899999876543321 1333 3468999998643 2 33333 347778788899999988887543
Q ss_pred CceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEee--cc-----ccceeEEEECCCCCEEEEEeCCCcEEEEEEc
Q 020784 217 KGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIM--AH-----DSRIACFALTQDGQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 217 ~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~--~H-----~~~V~~vafspdg~~las~S~Dgt~IrIWd~ 288 (321)
+ ..-+++++ ..++ +|+.|.+|+.||+.-.. +.++. .| .+.|.+|+..|.|++||+|-.|.. ..++|+
T Consensus 186 i-lalyswn~--~m~~-sgsqdktirfwdlrv~~~v~~l~~~~~~~glessavaav~vdpsgrll~sg~~dss-c~lydi 260 (350)
T KOG0641|consen 186 I-LALYSWNG--AMFA-SGSQDKTIRFWDLRVNSCVNTLDNDFHDGGLESSAVAAVAVDPSGRLLASGHADSS-CMLYDI 260 (350)
T ss_pred E-EEEEEecC--cEEE-ccCCCceEEEEeeeccceeeeccCcccCCCcccceeEEEEECCCcceeeeccCCCc-eEEEEe
Confidence 2 23346654 6666 79999999999987543 34432 12 367999999999999999999999 889999
Q ss_pred CCCcEEEEEeCCCcc--eeEEEeecCceEEEee
Q 020784 289 LDGTLLQEECCPSIS--AQSGLWLSSAWLRVLR 319 (321)
Q Consensus 289 ~tg~~i~~~~~g~~~--~~~~~s~d~~~la~~~ 319 (321)
+-|..++.|. .|.. ..+.|++.-.||..++
T Consensus 261 rg~r~iq~f~-phsadir~vrfsp~a~yllt~s 292 (350)
T KOG0641|consen 261 RGGRMIQRFH-PHSADIRCVRFSPGAHYLLTCS 292 (350)
T ss_pred eCCceeeeeC-CCccceeEEEeCCCceEEEEec
Confidence 9999999985 3333 3457888888887654
No 96
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.79 E-value=3.8e-18 Score=153.07 Aligned_cols=210 Identities=13% Similarity=0.149 Sum_probs=166.4
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCcee---EEe------ee--------ecCCceEEEEEecCCCeE
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREI---FRR------DF--------ERGGGIGVVEMLFRCNIL 142 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~---~~~------~~--------~~~~~v~~v~~~~~~~~~ 142 (321)
...|.-+|.||++++|+++..+++.++ |.=|++.+++.. ..+ ++ .|...+.+++++.++.++
T Consensus 138 ~~~H~~s~~~vals~d~~~~fsask~g~i~kw~v~tgk~~~~i~~~~ev~k~~~~~~k~~r~~h~keil~~avS~Dgkyl 217 (479)
T KOG0299|consen 138 IGKHQLSVTSVALSPDDKRVFSASKDGTILKWDVLTGKKDRYIIERDEVLKSHGNPLKESRKGHVKEILTLAVSSDGKYL 217 (479)
T ss_pred eccccCcceEEEeeccccceeecCCCcceeeeehhcCcccccccccchhhhhccCCCCcccccccceeEEEEEcCCCcEE
Confidence 356788999999999999999998865 668988766532 111 00 156678888999999999
Q ss_pred EEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeC-CceeEEEEeC--CeEEEE-ECCEEEEEEcCCcEEEEEEeccCCCCc
Q 020784 143 ALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFR-SEVRSVKLRR--DRIIVV-LEQKIFVYNFADLKLLHQIETIANPKG 218 (321)
Q Consensus 143 ~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~-~~v~~v~~~~--~~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~ 218 (321)
++.+ .|+.|.|||.++.+.+..+..+ ..|.+++|-. +.++++ .|..|++|++.....+.++-+|...+.
T Consensus 218 atgg-------~d~~v~Iw~~~t~ehv~~~~ghr~~V~~L~fr~gt~~lys~s~Drsvkvw~~~~~s~vetlyGHqd~v~ 290 (479)
T KOG0299|consen 218 ATGG-------RDRHVQIWDCDTLEHVKVFKGHRGAVSSLAFRKGTSELYSASADRSVKVWSIDQLSYVETLYGHQDGVL 290 (479)
T ss_pred EecC-------CCceEEEecCcccchhhcccccccceeeeeeecCccceeeeecCCceEEEehhHhHHHHHHhCCcccee
Confidence 8877 5789999999999988887655 5899999853 455555 577999999999988888888876554
Q ss_pred eEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEe
Q 020784 219 LCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEEC 298 (321)
Q Consensus 219 ~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~ 298 (321)
.++.... ...+. .|.-|.++++|.+......++.+|.+.+-|++|-.+ ..|+|||+||. |-+|++.+.+.+.+.+
T Consensus 291 ~IdaL~r--eR~vt-VGgrDrT~rlwKi~eesqlifrg~~~sidcv~~In~-~HfvsGSdnG~-IaLWs~~KKkplf~~~ 365 (479)
T KOG0299|consen 291 GIDALSR--ERCVT-VGGRDRTVRLWKIPEESQLIFRGGEGSIDCVAFIND-EHFVSGSDNGS-IALWSLLKKKPLFTSR 365 (479)
T ss_pred eechhcc--cceEE-eccccceeEEEeccccceeeeeCCCCCeeeEEEecc-cceeeccCCce-EEEeeecccCceeEee
Confidence 4443322 24444 589999999999977778899999999999999865 56899999999 9999999999998887
Q ss_pred CCCc
Q 020784 299 CPSI 302 (321)
Q Consensus 299 ~g~~ 302 (321)
..|.
T Consensus 366 ~AHg 369 (479)
T KOG0299|consen 366 LAHG 369 (479)
T ss_pred cccc
Confidence 6655
No 97
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.79 E-value=3.3e-18 Score=142.54 Aligned_cols=229 Identities=17% Similarity=0.155 Sum_probs=159.4
Q ss_pred cccCCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCce-eEEeeee-cCCceEEEEEec--CCCeEEEEeCCCCCCC
Q 020784 79 STSSSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFRE-IFRRDFE-RGGGIGVVEMLF--RCNILALVGGGPDPQY 153 (321)
Q Consensus 79 ~~~~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~-~~~~~~~-~~~~v~~v~~~~--~~~~~~~~sg~~~~~~ 153 (321)
.+...|+.-|..+...--|++||+++. +.|+|+.+..... ....++. |.+++-.+.|.. -++++|.++
T Consensus 5 ~idt~H~D~IHda~lDyygkrlATcsSD~tVkIf~v~~n~~s~ll~~L~Gh~GPVwqv~wahPk~G~iLAScs------- 77 (299)
T KOG1332|consen 5 TIDTQHEDMIHDAQLDYYGKRLATCSSDGTVKIFEVRNNGQSKLLAELTGHSGPVWKVAWAHPKFGTILASCS------- 77 (299)
T ss_pred ehhhhhhhhhhHhhhhhhcceeeeecCCccEEEEEEcCCCCceeeeEecCCCCCeeEEeecccccCcEeeEee-------
Confidence 444567778888888888999998776 5599999976553 2222332 789999999966 578888888
Q ss_pred CCCcEEEEeCCCCcEEEEEe---eCCceeEEEEeCCe----EEEE-ECCEEEEEEcCCc--EE-EEEEeccCCCCceEEE
Q 020784 154 PLNKVMIWDDHQSRCIGELS---FRSEVRSVKLRRDR----IIVV-LEQKIFVYNFADL--KL-LHQIETIANPKGLCAV 222 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~~~~---~~~~v~~v~~~~~~----~~~~-~~~~I~iwd~~~~--~~-~~~l~~~~~~~~~~~~ 222 (321)
.|++|.||.-.+++..+... +...|.+++|-+.. ++++ +|+.|.|.+.+.. -. -+....|.-.+..++.
T Consensus 78 YDgkVIiWke~~g~w~k~~e~~~h~~SVNsV~wapheygl~LacasSDG~vsvl~~~~~g~w~t~ki~~aH~~GvnsVsw 157 (299)
T KOG1332|consen 78 YDGKVIIWKEENGRWTKAYEHAAHSASVNSVAWAPHEYGLLLACASSDGKVSVLTYDSSGGWTTSKIVFAHEIGVNSVSW 157 (299)
T ss_pred cCceEEEEecCCCchhhhhhhhhhcccceeecccccccceEEEEeeCCCcEEEEEEcCCCCccchhhhhccccccceeee
Confidence 78999999988886433322 34589999987652 3333 4689999888542 11 1223344433444444
Q ss_pred eeCC-Cc-----------eEEEeecCCCCcEEEEeeCCcc---eEEeeccccceeEEEECCCC----CEEEEEeCCCcEE
Q 020784 223 SQGV-GS-----------LVLVCPGLQKGQVRVEHYASKR---TKFIMAHDSRIACFALTQDG----QLLATSSTKGTLV 283 (321)
Q Consensus 223 s~~~-d~-----------~~la~sGs~dg~V~i~d~~~~~---~~~l~~H~~~V~~vafspdg----~~las~S~Dgt~I 283 (321)
++.. ++ ..|+ +|+.|..|+||++.... ..+|.+|.+-|+.+||.|.- .+|||||+||+ |
T Consensus 158 apa~~~g~~~~~~~~~~~krlv-SgGcDn~VkiW~~~~~~w~~e~~l~~H~dwVRDVAwaP~~gl~~s~iAS~SqDg~-v 235 (299)
T KOG1332|consen 158 APASAPGSLVDQGPAAKVKRLV-SGGCDNLVKIWKFDSDSWKLERTLEGHKDWVRDVAWAPSVGLPKSTIASCSQDGT-V 235 (299)
T ss_pred cCcCCCccccccCcccccceee-ccCCccceeeeecCCcchhhhhhhhhcchhhhhhhhccccCCCceeeEEecCCCc-E
Confidence 4330 01 3366 69999999999988743 44799999999999999974 57999999999 8
Q ss_pred EEEEcCC------CcEEEEEeCCCcceeEEEeecCceEEEe
Q 020784 284 RIFNTLD------GTLLQEECCPSISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 284 rIWd~~t------g~~i~~~~~g~~~~~~~~s~d~~~la~~ 318 (321)
-||-.+. ++++++|. .-.-.++.|++|..|||+
T Consensus 236 iIwt~~~e~e~wk~tll~~f~--~~~w~vSWS~sGn~LaVs 274 (299)
T KOG1332|consen 236 IIWTKDEEYEPWKKTLLEEFP--DVVWRVSWSLSGNILAVS 274 (299)
T ss_pred EEEEecCccCcccccccccCC--cceEEEEEeccccEEEEe
Confidence 8997762 23334331 112356888999999985
No 98
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.79 E-value=2.4e-17 Score=148.85 Aligned_cols=197 Identities=14% Similarity=0.117 Sum_probs=150.3
Q ss_pred CCCCCCeEEEEEcCCC-CEEEEEcCCcEE-EEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 82 SSPPPTLLHISFNQDH-GCFAAGTDHGFR-IYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg-~~lasg~~~gv~-vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
..|..+|..+.|+|++ +.|++|+||.++ +||+.+......... |..-|.+.++++-...+++.| + .||+||
T Consensus 107 ~ah~apv~~~~f~~~d~t~l~s~sDd~v~k~~d~s~a~v~~~l~~-htDYVR~g~~~~~~~hivvtG-s-----YDg~vr 179 (487)
T KOG0310|consen 107 YAHQAPVHVTKFSPQDNTMLVSGSDDKVVKYWDLSTAYVQAELSG-HTDYVRCGDISPANDHIVVTG-S-----YDGKVR 179 (487)
T ss_pred hhccCceeEEEecccCCeEEEecCCCceEEEEEcCCcEEEEEecC-CcceeEeeccccCCCeEEEec-C-----CCceEE
Confidence 5688899999999854 677889987754 999988775333333 678899999988776665544 3 589999
Q ss_pred EEeCCCC-cEEEEEeeCCceeEEEEeCC--eEEEEECCEEEEEEcC-CcEEEEEEeccCCCCceEEEeeCCCceEEEeec
Q 020784 160 IWDDHQS-RCIGELSFRSEVRSVKLRRD--RIIVVLEQKIFVYNFA-DLKLLHQIETIANPKGLCAVSQGVGSLVLVCPG 235 (321)
Q Consensus 160 iWD~~~~-~~~~~~~~~~~v~~v~~~~~--~~~~~~~~~I~iwd~~-~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sG 235 (321)
+||.+.. ..+.++.+..+|-.+.+-+. .++.++++.|++||+. .++++..+..|...+.++++..++ .-|. ||
T Consensus 180 l~DtR~~~~~v~elnhg~pVe~vl~lpsgs~iasAgGn~vkVWDl~~G~qll~~~~~H~KtVTcL~l~s~~--~rLl-S~ 256 (487)
T KOG0310|consen 180 LWDTRSLTSRVVELNHGCPVESVLALPSGSLIASAGGNSVKVWDLTTGGQLLTSMFNHNKTVTCLRLASDS--TRLL-SG 256 (487)
T ss_pred EEEeccCCceeEEecCCCceeeEEEcCCCCEEEEcCCCeEEEEEecCCceehhhhhcccceEEEEEeecCC--ceEe-ec
Confidence 9999876 78889999999999998765 4555667799999997 456555555576667777776643 4555 59
Q ss_pred CCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcC
Q 020784 236 LQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 236 s~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~ 289 (321)
+-||.|+++|+.+-++..--...++|.+++.+|+++.++.|..||. +-+=+..
T Consensus 257 sLD~~VKVfd~t~~Kvv~s~~~~~pvLsiavs~dd~t~viGmsnGl-v~~rr~~ 309 (487)
T KOG0310|consen 257 SLDRHVKVFDTTNYKVVHSWKYPGPVLSIAVSPDDQTVVIGMSNGL-VSIRRRE 309 (487)
T ss_pred ccccceEEEEccceEEEEeeecccceeeEEecCCCceEEEecccce-eeeehhh
Confidence 9999999999655443333346789999999999999999999998 7555433
No 99
>KOG0306 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.79 E-value=1.1e-17 Score=157.82 Aligned_cols=202 Identities=14% Similarity=0.182 Sum_probs=160.9
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecC-----Cc--ee------EEeeeecCCceEEEEEecCCCeEEEEeC
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDP-----FR--EI------FRRDFERGGGIGVVEMLFRCNILALVGG 147 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~-----~~--~~------~~~~~~~~~~v~~v~~~~~~~~~~~~sg 147 (321)
..|.+.|.+++.+||++.+++|+. ++|++|+..- +. .. ...++ ...+.++++++++.+++++=
T Consensus 451 ~AHdgaIWsi~~~pD~~g~vT~saDktVkfWdf~l~~~~~gt~~k~lsl~~~rtLel--~ddvL~v~~Spdgk~LaVsL- 527 (888)
T KOG0306|consen 451 RAHDGAIWSISLSPDNKGFVTGSADKTVKFWDFKLVVSVPGTQKKVLSLKHTRTLEL--EDDVLCVSVSPDGKLLAVSL- 527 (888)
T ss_pred hccccceeeeeecCCCCceEEecCCcEEEEEeEEEEeccCcccceeeeeccceEEec--cccEEEEEEcCCCcEEEEEe-
Confidence 478899999999999999999987 5688998631 11 11 12233 56789999999999998876
Q ss_pred CCCCCCCCCcEEEEeCCCCcEEEEEeeCC-ceeEEEEeCCeEEEE--E-CCEEEEEEcCCcEEEEEEeccCCCCceEEEe
Q 020784 148 GPDPQYPLNKVMIWDDHQSRCIGELSFRS-EVRSVKLRRDRIIVV--L-EQKIFVYNFADLKLLHQIETIANPKGLCAVS 223 (321)
Q Consensus 148 ~~~~~~~d~~v~iWD~~~~~~~~~~~~~~-~v~~v~~~~~~~~~~--~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s 223 (321)
-|++|+||=+++.+....+-+|. +|.++.++++.-.++ + |+.|+||-+.=|.+-+.|-.|...+..+-|.
T Consensus 528 ------LdnTVkVyflDtlKFflsLYGHkLPV~smDIS~DSklivTgSADKnVKiWGLdFGDCHKS~fAHdDSvm~V~F~ 601 (888)
T KOG0306|consen 528 ------LDNTVKVYFLDTLKFFLSLYGHKLPVLSMDISPDSKLIVTGSADKNVKIWGLDFGDCHKSFFAHDDSVMSVQFL 601 (888)
T ss_pred ------ccCeEEEEEecceeeeeeecccccceeEEeccCCcCeEEeccCCCceEEeccccchhhhhhhcccCceeEEEEc
Confidence 68999999999988766666665 999999998754333 2 4699999999999999998887776666666
Q ss_pred eCCCceEEEeecCCCCcEEEEeeCC-cceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEE
Q 020784 224 QGVGSLVLVCPGLQKGQVRVEHYAS-KRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQE 296 (321)
Q Consensus 224 ~~~d~~~la~sGs~dg~V~i~d~~~-~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~ 296 (321)
|. ..++. +++.||.|+-||-.. ..+..+.+|...|+|++.+|+|.+++|+|.|.+ ||+|......++.+
T Consensus 602 P~--~~~FF-t~gKD~kvKqWDg~kFe~iq~L~~H~~ev~cLav~~~G~~vvs~shD~s-IRlwE~tde~~~lE 671 (888)
T KOG0306|consen 602 PK--THLFF-TCGKDGKVKQWDGEKFEEIQKLDGHHSEVWCLAVSPNGSFVVSSSHDKS-IRLWERTDEILILE 671 (888)
T ss_pred cc--ceeEE-EecCcceEEeechhhhhhheeeccchheeeeeEEcCCCCeEEeccCCce-eEeeeccCcceeee
Confidence 63 23333 579999999998654 457799999999999999999999999999999 99999777555443
No 100
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=99.79 E-value=4.8e-16 Score=138.91 Aligned_cols=213 Identities=10% Similarity=0.034 Sum_probs=147.7
Q ss_pred CeEEEEEcCCCCEEEEE-cC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC
Q 020784 87 TLLHISFNQDHGCFAAG-TD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH 164 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg-~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~ 164 (321)
.+..++|+|+|+.|+++ +. +.+++||+.+.+.+..... ......+.+++++..++++... ...+.+||.+
T Consensus 74 ~~~~~~~~~~g~~l~~~~~~~~~l~~~d~~~~~~~~~~~~--~~~~~~~~~~~dg~~l~~~~~~------~~~~~~~d~~ 145 (300)
T TIGR03866 74 DPELFALHPNGKILYIANEDDNLVTVIDIETRKVLAEIPV--GVEPEGMAVSPDGKIVVNTSET------TNMAHFIDTK 145 (300)
T ss_pred CccEEEECCCCCEEEEEcCCCCeEEEEECCCCeEEeEeeC--CCCcceEEECCCCCEEEEEecC------CCeEEEEeCC
Confidence 35678999999977654 43 4588999988766544442 3445677888888888776632 2457788998
Q ss_pred CCcEEEEEeeCCceeEEEEeCCe--EEEEE--CCEEEEEEcCCcEEEEEEeccC-----CCCceEEEeeCCCceEEEeec
Q 020784 165 QSRCIGELSFRSEVRSVKLRRDR--IIVVL--EQKIFVYNFADLKLLHQIETIA-----NPKGLCAVSQGVGSLVLVCPG 235 (321)
Q Consensus 165 ~~~~~~~~~~~~~v~~v~~~~~~--~~~~~--~~~I~iwd~~~~~~~~~l~~~~-----~~~~~~~~s~~~d~~~la~sG 235 (321)
+++....+.....+..+.|+++. +++.. ++.|++||+.+++.++.+..+. .......+..++++..+.++.
T Consensus 146 ~~~~~~~~~~~~~~~~~~~s~dg~~l~~~~~~~~~v~i~d~~~~~~~~~~~~~~~~~~~~~~~~~~i~~s~dg~~~~~~~ 225 (300)
T TIGR03866 146 TYEIVDNVLVDQRPRFAEFTADGKELWVSSEIGGTVSVIDVATRKVIKKITFEIPGVHPEAVQPVGIKLTKDGKTAFVAL 225 (300)
T ss_pred CCeEEEEEEcCCCccEEEECCCCCEEEEEcCCCCEEEEEEcCcceeeeeeeecccccccccCCccceEECCCCCEEEEEc
Confidence 88776665555566778887653 44443 5799999999998877765321 111222333444555543334
Q ss_pred CCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEE-eCCCcEEEEEEcCCCcEEEEEeCCCcceeEEE
Q 020784 236 LQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATS-STKGTLVRIFNTLDGTLLQEECCPSISAQSGL 308 (321)
Q Consensus 236 s~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~-S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~ 308 (321)
..++.|.+||..+..+.....+...+.+++|+|+|++|+++ +.+|+ |+|||+++++++.++..+...-.+.+
T Consensus 226 ~~~~~i~v~d~~~~~~~~~~~~~~~~~~~~~~~~g~~l~~~~~~~~~-i~v~d~~~~~~~~~~~~~~~~~~~~~ 298 (300)
T TIGR03866 226 GPANRVAVVDAKTYEVLDYLLVGQRVWQLAFTPDEKYLLTTNGVSND-VSVIDVAALKVIKSIKVGRLPWGVVV 298 (300)
T ss_pred CCCCeEEEEECCCCcEEEEEEeCCCcceEEECCCCCEEEEEcCCCCe-EEEEECCCCcEEEEEEcccccceeEe
Confidence 55668999998776654333455689999999999999876 45888 99999999999999987655444443
No 101
>KOG0643 consensus Translation initiation factor 3, subunit i (eIF-3i)/TGF-beta receptor-interacting protein (TRIP-1) [Translation, ribosomal structure and biogenesis; Signal transduction mechanisms]
Probab=99.78 E-value=2.5e-17 Score=138.85 Aligned_cols=216 Identities=13% Similarity=0.127 Sum_probs=157.7
Q ss_pred CCCCCCCCCCCCcccCCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEE
Q 020784 67 PNYQMPLPSPAESTSSSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALV 145 (321)
Q Consensus 67 ~~~~~~~~~~~~~~~~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~ 145 (321)
++.|......+.-...+|.+.|.||..+.+.++|++|+. .+++|||+++++.+..+.+ ...+..+++.+++++.+.+
T Consensus 34 ~~vw~s~nGerlGty~GHtGavW~~Did~~s~~liTGSAD~t~kLWDv~tGk~la~~k~--~~~Vk~~~F~~~gn~~l~~ 111 (327)
T KOG0643|consen 34 PTVWYSLNGERLGTYDGHTGAVWCCDIDWDSKHLITGSADQTAKLWDVETGKQLATWKT--NSPVKRVDFSFGGNLILAS 111 (327)
T ss_pred ceEEEecCCceeeeecCCCceEEEEEecCCcceeeeccccceeEEEEcCCCcEEEEeec--CCeeEEEeeccCCcEEEEE
Confidence 344444344444556789999999999999999999997 5589999999999999986 7899999999999988877
Q ss_pred eCCCCCCCCCCcEEEEeCCC-------CcEEEEEe-eCCceeEEEEeCC--eEEEEE-CCEEEEEEcCCc-EEEEEEecc
Q 020784 146 GGGPDPQYPLNKVMIWDDHQ-------SRCIGELS-FRSEVRSVKLRRD--RIIVVL-EQKIFVYNFADL-KLLHQIETI 213 (321)
Q Consensus 146 sg~~~~~~~d~~v~iWD~~~-------~~~~~~~~-~~~~v~~v~~~~~--~~~~~~-~~~I~iwd~~~~-~~~~~l~~~ 213 (321)
....-. ....|.++|++. .+.+..+. ..+.++.+-|.+. .++.+. ++.|.+||.+++ +.+...+.|
T Consensus 112 tD~~mg--~~~~v~~fdi~~~~~~~~s~ep~~kI~t~~skit~a~Wg~l~~~ii~Ghe~G~is~~da~~g~~~v~s~~~h 189 (327)
T KOG0643|consen 112 TDKQMG--YTCFVSVFDIRDDSSDIDSEEPYLKIPTPDSKITSALWGPLGETIIAGHEDGSISIYDARTGKELVDSDEEH 189 (327)
T ss_pred ehhhcC--cceEEEEEEccCChhhhcccCceEEecCCccceeeeeecccCCEEEEecCCCcEEEEEcccCceeeechhhh
Confidence 643211 236799999873 33333333 3456777788763 344443 479999999987 445555556
Q ss_pred CCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCc--------------------------------------------
Q 020784 214 ANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASK-------------------------------------------- 249 (321)
Q Consensus 214 ~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~-------------------------------------------- 249 (321)
...+. .+.+.+|..+++ +|+.|.+-++||..+-
T Consensus 190 ~~~In--d~q~s~d~T~Fi-T~s~Dttakl~D~~tl~v~Kty~te~PvN~aaisP~~d~VilgGGqeA~dVTTT~~r~GK 266 (327)
T KOG0643|consen 190 SSKIN--DLQFSRDRTYFI-TGSKDTTAKLVDVRTLEVLKTYTTERPVNTAAISPLLDHVILGGGQEAMDVTTTSTRAGK 266 (327)
T ss_pred ccccc--cccccCCcceEE-ecccCccceeeeccceeeEEEeeecccccceecccccceEEecCCceeeeeeeecccccc
Confidence 55444 444445557777 5899998888874310
Q ss_pred ------------ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 250 ------------RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 250 ------------~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
.+-.+++|=++|++|||+|+|+..+||++||. |||--+..
T Consensus 267 FEArFyh~i~eEEigrvkGHFGPINsvAfhPdGksYsSGGEDG~-VR~h~Fd~ 318 (327)
T KOG0643|consen 267 FEARFYHLIFEEEIGRVKGHFGPINSVAFHPDGKSYSSGGEDGY-VRLHHFDS 318 (327)
T ss_pred hhhhHHHHHHHHHhccccccccCcceeEECCCCcccccCCCCce-EEEEEecc
Confidence 12245789999999999999999999999999 99875543
No 102
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=99.78 E-value=5.3e-17 Score=144.83 Aligned_cols=201 Identities=13% Similarity=0.155 Sum_probs=152.6
Q ss_pred CcccCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeee-cCCceEEEEEecCCCeEEEEeCCCCCCCCC
Q 020784 78 ESTSSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFE-RGGGIGVVEMLFRCNILALVGGGPDPQYPL 155 (321)
Q Consensus 78 ~~~~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~-~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d 155 (321)
....+.|.++|+.+..+|.|.||+++++++ ..+.|..++..+...... .+-.+...++++++.++.+.. .|
T Consensus 296 ~~~~~~h~~~V~~ls~h~tgeYllsAs~d~~w~Fsd~~~g~~lt~vs~~~s~v~~ts~~fHpDgLifgtgt-------~d 368 (506)
T KOG0289|consen 296 PTSSRPHEEPVTGLSLHPTGEYLLSASNDGTWAFSDISSGSQLTVVSDETSDVEYTSAAFHPDGLIFGTGT-------PD 368 (506)
T ss_pred ccccccccccceeeeeccCCcEEEEecCCceEEEEEccCCcEEEEEeeccccceeEEeeEcCCceEEeccC-------CC
Confidence 344578999999999999999999999977 457888888766554420 012355666677776665544 68
Q ss_pred CcEEEEeCCCCcEEEEEeeC-CceeEEEEeCCe--EEEEECC-EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEE
Q 020784 156 NKVMIWDDHQSRCIGELSFR-SEVRSVKLRRDR--IIVVLEQ-KIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVL 231 (321)
Q Consensus 156 ~~v~iWD~~~~~~~~~~~~~-~~v~~v~~~~~~--~~~~~~~-~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~l 231 (321)
+.|+|||+..+..+..|..+ ++|.++.|..++ ++++.++ .|++||+++.+.++++...... .+.+++++..|.+|
T Consensus 369 ~~vkiwdlks~~~~a~Fpght~~vk~i~FsENGY~Lat~add~~V~lwDLRKl~n~kt~~l~~~~-~v~s~~fD~SGt~L 447 (506)
T KOG0289|consen 369 GVVKIWDLKSQTNVAKFPGHTGPVKAISFSENGYWLATAADDGSVKLWDLRKLKNFKTIQLDEKK-EVNSLSFDQSGTYL 447 (506)
T ss_pred ceEEEEEcCCccccccCCCCCCceeEEEeccCceEEEEEecCCeEEEEEehhhcccceeeccccc-cceeEEEcCCCCeE
Confidence 99999999999888888765 489999998775 4444554 6999999999988888765443 56777778888999
Q ss_pred EeecCCCCcEEEEeeCCc---ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEc
Q 020784 232 VCPGLQKGQVRVEHYASK---RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 232 a~sGs~dg~V~i~d~~~~---~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~ 288 (321)
++ ++.|=.|++.+-.++ .+..+..|.+..+++.|..+.++++++|.|.. .||+.+
T Consensus 448 ~~-~g~~l~Vy~~~k~~k~W~~~~~~~~~sg~st~v~Fg~~aq~l~s~smd~~-l~~~a~ 505 (506)
T KOG0289|consen 448 GI-AGSDLQVYICKKKTKSWTEIKELADHSGLSTGVRFGEHAQYLASTSMDAI-LRLYAL 505 (506)
T ss_pred Ee-ecceeEEEEEecccccceeeehhhhcccccceeeecccceEEeeccchhh-eEEeec
Confidence 86 555544555543333 35577889999999999999999999999998 888754
No 103
>KOG0640 consensus mRNA cleavage stimulating factor complex; subunit 1 [RNA processing and modification]
Probab=99.78 E-value=9.4e-18 Score=144.11 Aligned_cols=194 Identities=13% Similarity=0.231 Sum_probs=150.8
Q ss_pred CCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeee--ecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 85 PPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDF--ERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 85 ~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~--~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
..+|+|++|+|.|.+|+.|.+ ..+++||+++.++.....- +|.+.|..|..+..+++.++++ .||.||||
T Consensus 216 ~~~vrsiSfHPsGefllvgTdHp~~rlYdv~T~QcfvsanPd~qht~ai~~V~Ys~t~~lYvTaS-------kDG~Iklw 288 (430)
T KOG0640|consen 216 TEPVRSISFHPSGEFLLVGTDHPTLRLYDVNTYQCFVSANPDDQHTGAITQVRYSSTGSLYVTAS-------KDGAIKLW 288 (430)
T ss_pred cceeeeEeecCCCceEEEecCCCceeEEeccceeEeeecCcccccccceeEEEecCCccEEEEec-------cCCcEEee
Confidence 358999999999999999999 5688999999877554332 1678899999999999998888 78999999
Q ss_pred eCCCCcEEEEEee---CCceeEEEEeCCeEEEEE---CCEEEEEEcCCcEEEEEEeccC----CCCce-EEEeeCCCceE
Q 020784 162 DDHQSRCIGELSF---RSEVRSVKLRRDRIIVVL---EQKIFVYNFADLKLLHQIETIA----NPKGL-CAVSQGVGSLV 230 (321)
Q Consensus 162 D~~~~~~~~~~~~---~~~v~~v~~~~~~~~~~~---~~~I~iwd~~~~~~~~~l~~~~----~~~~~-~~~s~~~d~~~ 230 (321)
|-..++|+.++.- ..+|.+..|..+..++.+ |..+++|.+.+++.++.+.+.. +.... ..|+.. ..+
T Consensus 289 DGVS~rCv~t~~~AH~gsevcSa~Ftkn~kyiLsSG~DS~vkLWEi~t~R~l~~YtGAg~tgrq~~rtqAvFNht--Edy 366 (430)
T KOG0640|consen 289 DGVSNRCVRTIGNAHGGSEVCSAVFTKNGKYILSSGKDSTVKLWEISTGRMLKEYTGAGTTGRQKHRTQAVFNHT--EDY 366 (430)
T ss_pred ccccHHHHHHHHhhcCCceeeeEEEccCCeEEeecCCcceeeeeeecCCceEEEEecCCcccchhhhhhhhhcCc--cce
Confidence 9999999887753 347999999887655543 3599999999999999887642 11122 223333 344
Q ss_pred EEeecCCCCcEEEEeeCCcceE--EeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEc
Q 020784 231 LVCPGLQKGQVRVEHYASKRTK--FIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 231 la~sGs~dg~V~i~d~~~~~~~--~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~ 288 (321)
+.+.....+.++-||..+.... .-.+|++.|+++.-||.+.-|+|||.|.. +|.|--
T Consensus 367 Vl~pDEas~slcsWdaRtadr~~l~slgHn~a~R~i~HSP~~p~FmTcsdD~r-aRFWyr 425 (430)
T KOG0640|consen 367 VLFPDEASNSLCSWDARTADRVALLSLGHNGAVRWIVHSPVEPAFMTCSDDFR-ARFWYR 425 (430)
T ss_pred EEccccccCceeeccccchhhhhhcccCCCCCceEEEeCCCCCceeeecccce-eeeeee
Confidence 5444556667777998876543 34589999999999999999999999999 999953
No 104
>KOG1539 consensus WD repeat protein [General function prediction only]
Probab=99.77 E-value=4.4e-17 Score=155.28 Aligned_cols=221 Identities=14% Similarity=0.174 Sum_probs=161.9
Q ss_pred CeEEEEEcCC-----CCEEEEEcC-CcEEEEEecCCce-eEEeeee----cCCceEEEEEecCCCeEEEEeCCCCCCCCC
Q 020784 87 TLLHISFNQD-----HGCFAAGTD-HGFRIYNCDPFRE-IFRRDFE----RGGGIGVVEMLFRCNILALVGGGPDPQYPL 155 (321)
Q Consensus 87 ~V~~v~fs~d-----g~~lasg~~-~gv~vw~~~~~~~-~~~~~~~----~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d 155 (321)
+|...+|..+ .+.+++--+ ...+.|++..... .+..... .+..+.++++++.+|...+.. +.
T Consensus 397 ~i~~fa~~~~RE~~W~Nv~~~h~~~~~~~tW~~~n~~~G~~~L~~~~~~~~~~~~~av~vs~CGNF~~IG~-------S~ 469 (910)
T KOG1539|consen 397 PIVEFAFENAREKEWDNVITAHKGKRSAYTWNFRNKTSGRHVLDPKRFKKDDINATAVCVSFCGNFVFIGY-------SK 469 (910)
T ss_pred cceeeecccchhhhhcceeEEecCcceEEEEeccCcccccEEecCccccccCcceEEEEEeccCceEEEec-------cC
Confidence 6777776642 233333333 4467999865432 2222210 135678888899998776665 55
Q ss_pred CcEEEEeCCCCcEEEEE----eeCCceeEEEEeCC-e-EEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCc
Q 020784 156 NKVMIWDDHQSRCIGEL----SFRSEVRSVKLRRD-R-IIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGS 228 (321)
Q Consensus 156 ~~v~iWD~~~~~~~~~~----~~~~~v~~v~~~~~-~-~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~ 228 (321)
|+|-++|++.|-....+ .+..+|++++...- + ++.+ .+|.+++||+.+..++.++....... .+..+- ..
T Consensus 470 G~Id~fNmQSGi~r~sf~~~~ah~~~V~gla~D~~n~~~vsa~~~Gilkfw~f~~k~l~~~l~l~~~~~-~iv~hr--~s 546 (910)
T KOG1539|consen 470 GTIDRFNMQSGIHRKSFGDSPAHKGEVTGLAVDGTNRLLVSAGADGILKFWDFKKKVLKKSLRLGSSIT-GIVYHR--VS 546 (910)
T ss_pred CeEEEEEcccCeeecccccCccccCceeEEEecCCCceEEEccCcceEEEEecCCcceeeeeccCCCcc-eeeeee--hh
Confidence 99999999999888877 45668999998753 2 3333 46899999999988888887653322 222222 22
Q ss_pred eEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEE
Q 020784 229 LVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSG 307 (321)
Q Consensus 229 ~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~ 307 (321)
.++|+ +..|-.|+++|..+.. ...|.+|.+.|+.++|||||++|++++.|++ ||+||+.+|.++..+........++
T Consensus 547 ~l~a~-~~ddf~I~vvD~~t~kvvR~f~gh~nritd~~FS~DgrWlisasmD~t-Ir~wDlpt~~lID~~~vd~~~~sls 624 (910)
T KOG1539|consen 547 DLLAI-ALDDFSIRVVDVVTRKVVREFWGHGNRITDMTFSPDGRWLISASMDST-IRTWDLPTGTLIDGLLVDSPCTSLS 624 (910)
T ss_pred hhhhh-hcCceeEEEEEchhhhhhHHhhccccceeeeEeCCCCcEEEEeecCCc-EEEEeccCcceeeeEecCCcceeeE
Confidence 45553 6778889999888766 4589999999999999999999999999999 9999999999999886655555679
Q ss_pred EeecCceEEEee
Q 020784 308 LWLSSAWLRVLR 319 (321)
Q Consensus 308 ~s~d~~~la~~~ 319 (321)
|+++|.|||++-
T Consensus 625 ~SPngD~LAT~H 636 (910)
T KOG1539|consen 625 FSPNGDFLATVH 636 (910)
T ss_pred ECCCCCEEEEEE
Confidence 999999999874
No 105
>KOG0283 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.77 E-value=3.2e-17 Score=156.58 Aligned_cols=199 Identities=14% Similarity=0.145 Sum_probs=153.6
Q ss_pred ccCCCCCCeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCC-CeEEEEeCCCCCCCCCCcE
Q 020784 80 TSSSPPPTLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRC-NILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 80 ~~~~~~~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~-~~~~~~sg~~~~~~~d~~v 158 (321)
...+|.+.|..++||.++-+|.++.|++||||+.....++.... |..=|++|++.|.. ++++.++ -|++|
T Consensus 364 ef~GHt~DILDlSWSKn~fLLSSSMDKTVRLWh~~~~~CL~~F~--HndfVTcVaFnPvDDryFiSGS-------LD~Kv 434 (712)
T KOG0283|consen 364 EFKGHTADILDLSWSKNNFLLSSSMDKTVRLWHPGRKECLKVFS--HNDFVTCVAFNPVDDRYFISGS-------LDGKV 434 (712)
T ss_pred hhhccchhheecccccCCeeEeccccccEEeecCCCcceeeEEe--cCCeeEEEEecccCCCcEeecc-------cccce
Confidence 34789999999999999988888888999999999887776655 68889999999854 5554444 68999
Q ss_pred EEEeCCCCcEEEEEeeCCceeEEEEeCCe--EEEE-ECCEEEEEEcCCcEEEEEEeccCC------CCceEEEeeCCCc-
Q 020784 159 MIWDDHQSRCIGELSFRSEVRSVKLRRDR--IIVV-LEQKIFVYNFADLKLLHQIETIAN------PKGLCAVSQGVGS- 228 (321)
Q Consensus 159 ~iWD~~~~~~~~~~~~~~~v~~v~~~~~~--~~~~-~~~~I~iwd~~~~~~~~~l~~~~~------~~~~~~~s~~~d~- 228 (321)
|||++...+.+.-.+.+.-|+++++.|++ .+++ ..|.+++|++...++...+.-+.. ...+..|.+.+..
T Consensus 435 RiWsI~d~~Vv~W~Dl~~lITAvcy~PdGk~avIGt~~G~C~fY~t~~lk~~~~~~I~~~~~Kk~~~~rITG~Q~~p~~~ 514 (712)
T KOG0283|consen 435 RLWSISDKKVVDWNDLRDLITAVCYSPDGKGAVIGTFNGYCRFYDTEGLKLVSDFHIRLHNKKKKQGKRITGLQFFPGDP 514 (712)
T ss_pred EEeecCcCeeEeehhhhhhheeEEeccCCceEEEEEeccEEEEEEccCCeEEEeeeEeeccCccccCceeeeeEecCCCC
Confidence 99999999888877888899999999875 3343 368999999998888776643221 1134555443222
Q ss_pred -eEEEeecCCCCcEEEEeeCCcc-eEEeeccccc--eeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 229 -LVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSR--IACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 229 -~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~--V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
.+|+ .+.|..|+|+|..... +..|+|+.+. -....|+.||++++++|+|.. |.||++..
T Consensus 515 ~~vLV--TSnDSrIRI~d~~~~~lv~KfKG~~n~~SQ~~Asfs~Dgk~IVs~seDs~-VYiW~~~~ 577 (712)
T KOG0283|consen 515 DEVLV--TSNDSRIRIYDGRDKDLVHKFKGFRNTSSQISASFSSDGKHIVSASEDSW-VYIWKNDS 577 (712)
T ss_pred CeEEE--ecCCCceEEEeccchhhhhhhcccccCCcceeeeEccCCCEEEEeecCce-EEEEeCCC
Confidence 4666 4889999999987655 5578876543 456789999999999998888 99999854
No 106
>KOG0973 consensus Histone transcription regulator HIRA, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=99.76 E-value=1.8e-17 Score=161.98 Aligned_cols=202 Identities=17% Similarity=0.140 Sum_probs=148.4
Q ss_pred CCCeEEEEEcCCCCEEEEEc--C-CcEEEEEecCCc------------eeEEeeeecCCceEEEEEecCCCeEEEEeCCC
Q 020784 85 PPTLLHISFNQDHGCFAAGT--D-HGFRIYNCDPFR------------EIFRRDFERGGGIGVVEMLFRCNILALVGGGP 149 (321)
Q Consensus 85 ~~~V~~v~fs~dg~~lasg~--~-~gv~vw~~~~~~------------~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~ 149 (321)
...|.+|..+|||..+|+|+ - .+++||+.+... .+.... +|.+.+.|+.|++++.++|+++
T Consensus 13 ~~~IfSIdv~pdg~~~aTgGq~~d~~~~iW~~~~vl~~~~~~~~~l~k~l~~m~-~h~~sv~CVR~S~dG~~lAsGS--- 88 (942)
T KOG0973|consen 13 EKSIFSIDVHPDGVKFATGGQVLDGGIVIWSQDPVLDEKEEKNENLPKHLCTMD-DHDGSVNCVRFSPDGSYLASGS--- 88 (942)
T ss_pred CeeEEEEEecCCceeEecCCccccccceeeccccccchhhhhhcccchhheeec-cccCceeEEEECCCCCeEeecc---
Confidence 34699999999999999999 3 457899875432 111111 1789999999999999998887
Q ss_pred CCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCeEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCce
Q 020784 150 DPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDRIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSL 229 (321)
Q Consensus 150 ~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~ 229 (321)
+|+-|.||+..... ...+ +.+ ++ ..-+.++.+.+..+.+|...+.-+++ .|++.
T Consensus 89 ----DD~~v~iW~~~~~~-------~~~~---fgs-------~g---~~~~vE~wk~~~~l~~H~~DV~Dv~W--sp~~~ 142 (942)
T KOG0973|consen 89 ----DDRLVMIWERAEIG-------SGTV---FGS-------TG---GAKNVESWKVVSILRGHDSDVLDVNW--SPDDS 142 (942)
T ss_pred ----CcceEEEeeecccC-------Cccc---ccc-------cc---cccccceeeEEEEEecCCCccceecc--CCCcc
Confidence 67999999865410 0010 000 00 01133456677888888776554444 55668
Q ss_pred EEEeecCCCCcEEEEeeCC-cceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCc------
Q 020784 230 VLVCPGLQKGQVRVEHYAS-KRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSI------ 302 (321)
Q Consensus 230 ~la~sGs~dg~V~i~d~~~-~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~------ 302 (321)
++| +++.|++|.||+..+ +.++++++|.+.|-.+.|.|-|+||||-|+|++ |+||++.+-.+.++...-..
T Consensus 143 ~lv-S~s~DnsViiwn~~tF~~~~vl~~H~s~VKGvs~DP~Gky~ASqsdDrt-ikvwrt~dw~i~k~It~pf~~~~~~T 220 (942)
T KOG0973|consen 143 LLV-SVSLDNSVIIWNAKTFELLKVLRGHQSLVKGVSWDPIGKYFASQSDDRT-LKVWRTSDWGIEKSITKPFEESPLTT 220 (942)
T ss_pred EEE-EecccceEEEEccccceeeeeeecccccccceEECCccCeeeeecCCce-EEEEEcccceeeEeeccchhhCCCcc
Confidence 888 699999999999876 447799999999999999999999999999999 99999888766666542222
Q ss_pred -ceeEEEeecCceEEEe
Q 020784 303 -SAQSGLWLSSAWLRVL 318 (321)
Q Consensus 303 -~~~~~~s~d~~~la~~ 318 (321)
-.+++.||||+|||+.
T Consensus 221 ~f~RlSWSPDG~~las~ 237 (942)
T KOG0973|consen 221 FFLRLSWSPDGHHLASP 237 (942)
T ss_pred eeeecccCCCcCeecch
Confidence 2344778999999874
No 107
>KOG0269 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.76 E-value=8.2e-18 Score=159.11 Aligned_cols=222 Identities=13% Similarity=0.184 Sum_probs=156.0
Q ss_pred CCeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEE--eeee--cC--CceEEEEE-ecCCCeEEEEeCCCCCCCCCCcE
Q 020784 86 PTLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFR--RDFE--RG--GGIGVVEM-LFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~--~~~~--~~--~~v~~v~~-~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
.....|+.++|-..+++++.....||.+.+...... ..+. .. -....|.| ....+++|+++ ..|.|
T Consensus 40 ~~~nAIs~nr~~~qiv~AGrs~lklyai~~~~~~~~~~~~~k~kqn~~~S~~DVkW~~~~~NlIAT~s-------~nG~i 112 (839)
T KOG0269|consen 40 AKANAISVNRDINQIVVAGRSLLKLYAINPNDFSEKCNHRFKTKQNKFYSAADVKWGQLYSNLIATCS-------TNGVI 112 (839)
T ss_pred cccceEeecCCcceeEEecccceeeEeeCcccCCcceeeecccccceeeehhhcccccchhhhheeec-------CCCcE
Confidence 367788899999999999988888887754322111 1110 01 12233444 34578888888 66999
Q ss_pred EEEeCCC---CcEEEEEee-CCceeEEEEeC---CeEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceE
Q 020784 159 MIWDDHQ---SRCIGELSF-RSEVRSVKLRR---DRIIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLV 230 (321)
Q Consensus 159 ~iWD~~~---~~~~~~~~~-~~~v~~v~~~~---~~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~ 230 (321)
.+||+.. .+.+..|.. ...+.+++||. ..++.++ |+.|++||++..+...++.+....+.-+.|++..++ .
T Consensus 113 ~vWdlnk~~rnk~l~~f~EH~Rs~~~ldfh~tep~iliSGSQDg~vK~~DlR~~~S~~t~~~nSESiRDV~fsp~~~~-~ 191 (839)
T KOG0269|consen 113 SVWDLNKSIRNKLLTVFNEHERSANKLDFHSTEPNILISGSQDGTVKCWDLRSKKSKSTFRSNSESIRDVKFSPGYGN-K 191 (839)
T ss_pred EEEecCccccchhhhHhhhhccceeeeeeccCCccEEEecCCCceEEEEeeecccccccccccchhhhceeeccCCCc-e
Confidence 9999987 333334443 44799999985 4455554 579999999988888888775556667788887654 4
Q ss_pred EEeecCCCCcEEEEeeCCc--ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcE--EEEEeCCCcceeE
Q 020784 231 LVCPGLQKGQVRVEHYASK--RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTL--LQEECCPSISAQS 306 (321)
Q Consensus 231 la~sGs~dg~V~i~d~~~~--~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~--i~~~~~g~~~~~~ 306 (321)
++ ++...|.+..||++.- ....|.+|.++|.|+.|+|++.+|||||.|++ |||||+.+++. +.+........++
T Consensus 192 F~-s~~dsG~lqlWDlRqp~r~~~k~~AH~GpV~c~nwhPnr~~lATGGRDK~-vkiWd~t~~~~~~~~tInTiapv~rV 269 (839)
T KOG0269|consen 192 FA-SIHDSGYLQLWDLRQPDRCEKKLTAHNGPVLCLNWHPNREWLATGGRDKM-VKIWDMTDSRAKPKHTINTIAPVGRV 269 (839)
T ss_pred EE-EecCCceEEEeeccCchhHHHHhhcccCceEEEeecCCCceeeecCCCcc-EEEEeccCCCccceeEEeecceeeee
Confidence 44 4899999999999863 35688999999999999999999999999999 99999987653 4444443333333
Q ss_pred EEeecCce-EEE
Q 020784 307 GLWLSSAW-LRV 317 (321)
Q Consensus 307 ~~s~d~~~-la~ 317 (321)
.+=+.-+| ||.
T Consensus 270 kWRP~~~~hLAt 281 (839)
T KOG0269|consen 270 KWRPARSYHLAT 281 (839)
T ss_pred eeccCccchhhh
Confidence 33333333 443
No 108
>KOG0300 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.76 E-value=5e-17 Score=140.07 Aligned_cols=215 Identities=10% Similarity=0.152 Sum_probs=155.5
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
.+|+..|..++.......+.+++. .+.+||.+++++++..+.. |.|.+.++.+++.+.++++++| |++..|
T Consensus 145 ~GHkDGiW~Vaa~~tqpi~gtASADhTA~iWs~Esg~CL~~Y~G-H~GSVNsikfh~s~~L~lTaSG-------D~taHI 216 (481)
T KOG0300|consen 145 EGHKDGIWHVAADSTQPICGTASADHTARIWSLESGACLATYTG-HTGSVNSIKFHNSGLLLLTASG-------DETAHI 216 (481)
T ss_pred cccccceeeehhhcCCcceeecccccceeEEeeccccceeeecc-cccceeeEEeccccceEEEccC-------CcchHH
Confidence 578889999998877777888876 5578999999999888876 8899999999998888887774 467777
Q ss_pred Ee------CCC-----C-------------------------c----EEEEEeeCC-ceeEEEEe--CCeEEE-EECCEE
Q 020784 161 WD------DHQ-----S-------------------------R----CIGELSFRS-EVRSVKLR--RDRIIV-VLEQKI 196 (321)
Q Consensus 161 WD------~~~-----~-------------------------~----~~~~~~~~~-~v~~v~~~--~~~~~~-~~~~~I 196 (321)
|. +-. + . .+..+..+. .|.+..|- .+.++. ..|.+-
T Consensus 217 W~~av~~~vP~~~a~~~hSsEeE~e~sDe~~~d~d~~~~sD~~tiRvPl~~ltgH~~vV~a~dWL~gg~Q~vTaSWDRTA 296 (481)
T KOG0300|consen 217 WKAAVNWEVPSNNAPSDHSSEEEEEHSDEHNRDTDSSEKSDGHTIRVPLMRLTGHRAVVSACDWLAGGQQMVTASWDRTA 296 (481)
T ss_pred HHHhhcCcCCCCCCCCCCCchhhhhcccccccccccccccCCceeeeeeeeeeccccceEehhhhcCcceeeeeeccccc
Confidence 75 100 0 0 011122221 23333342 223333 346799
Q ss_pred EEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCc--ceEEeeccccceeEEEECCCCCEEE
Q 020784 197 FVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASK--RTKFIMAHDSRIACFALTQDGQLLA 274 (321)
Q Consensus 197 ~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~--~~~~l~~H~~~V~~vafspdg~~la 274 (321)
.+||+++++.++.+.+|.....-|+-++ ...+++ +.+.|-+.++||+... .+.+|++|...|+++.|..+. .++
T Consensus 297 nlwDVEtge~v~~LtGHd~ELtHcstHp--tQrLVv-TsSrDtTFRLWDFReaI~sV~VFQGHtdtVTS~vF~~dd-~vV 372 (481)
T KOG0300|consen 297 NLWDVETGEVVNILTGHDSELTHCSTHP--TQRLVV-TSSRDTTFRLWDFREAIQSVAVFQGHTDTVTSVVFNTDD-RVV 372 (481)
T ss_pred eeeeeccCceeccccCcchhccccccCC--cceEEE-EeccCceeEeccchhhcceeeeecccccceeEEEEecCC-cee
Confidence 9999999999999999988766666555 446655 6899999999999853 356899999999999999765 478
Q ss_pred EEeCCCcEEEEEEcCCCc-EEEEEeCCCcceeEEEe
Q 020784 275 TSSTKGTLVRIFNTLDGT-LLQEECCPSISAQSGLW 309 (321)
Q Consensus 275 s~S~Dgt~IrIWd~~tg~-~i~~~~~g~~~~~~~~s 309 (321)
+||+|.+ |||||+++.. .+.+++.......+.++
T Consensus 373 SgSDDrT-vKvWdLrNMRsplATIRtdS~~NRvavs 407 (481)
T KOG0300|consen 373 SGSDDRT-VKVWDLRNMRSPLATIRTDSPANRVAVS 407 (481)
T ss_pred ecCCCce-EEEeeeccccCcceeeecCCccceeEee
Confidence 9999999 9999999754 45666544333333433
No 109
>KOG0639 consensus Transducin-like enhancer of split protein (contains WD40 repeats) [Chromatin structure and dynamics]
Probab=99.76 E-value=1.1e-17 Score=151.52 Aligned_cols=223 Identities=9% Similarity=0.158 Sum_probs=170.2
Q ss_pred CCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeee-cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 84 PPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFE-RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~-~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
..+-|++|-..|||+.|++|+. .++.|||+.........++. ..-....++++++.+..+.+. .||.|+||
T Consensus 464 rdnyiRSckL~pdgrtLivGGeastlsiWDLAapTprikaeltssapaCyALa~spDakvcFscc-------sdGnI~vw 536 (705)
T KOG0639|consen 464 RDNYIRSCKLLPDGRTLIVGGEASTLSIWDLAAPTPRIKAELTSSAPACYALAISPDAKVCFSCC-------SDGNIAVW 536 (705)
T ss_pred cccceeeeEecCCCceEEeccccceeeeeeccCCCcchhhhcCCcchhhhhhhcCCccceeeeec-------cCCcEEEE
Confidence 3468999999999999999999 66889999765433333331 012344567788887666555 68999999
Q ss_pred eCCCCcEEEEEeeCC-ceeEEEEeCC--eEEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCC
Q 020784 162 DDHQSRCIGELSFRS-EVRSVKLRRD--RIIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQ 237 (321)
Q Consensus 162 D~~~~~~~~~~~~~~-~v~~v~~~~~--~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~ 237 (321)
|+++...++.|+.+. .+.++.++++ ++..+ .|++||.||++.+..++..+.. ..++++...+.+.++|+ |=.
T Consensus 537 DLhnq~~VrqfqGhtDGascIdis~dGtklWTGGlDntvRcWDlregrqlqqhdF~---SQIfSLg~cP~~dWlav-GMe 612 (705)
T KOG0639|consen 537 DLHNQTLVRQFQGHTDGASCIDISKDGTKLWTGGLDNTVRCWDLREGRQLQQHDFS---SQIFSLGYCPTGDWLAV-GME 612 (705)
T ss_pred EcccceeeecccCCCCCceeEEecCCCceeecCCCccceeehhhhhhhhhhhhhhh---hhheecccCCCccceee-ecc
Confidence 999999999998765 6888998865 45554 4689999999987765544332 23445555556678885 999
Q ss_pred CCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEE
Q 020784 238 KGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRV 317 (321)
Q Consensus 238 dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~ 317 (321)
++.|.|..........+..|.+-|.++.|.+-|++|++.+.|+- +..|.+.-|.-+.+.+.......--+|+|.+|+..
T Consensus 613 ns~vevlh~skp~kyqlhlheScVLSlKFa~cGkwfvStGkDnl-LnawrtPyGasiFqskE~SsVlsCDIS~ddkyIVT 691 (705)
T KOG0639|consen 613 NSNVEVLHTSKPEKYQLHLHESCVLSLKFAYCGKWFVSTGKDNL-LNAWRTPYGASIFQSKESSSVLSCDISFDDKYIVT 691 (705)
T ss_pred cCcEEEEecCCccceeecccccEEEEEEecccCceeeecCchhh-hhhccCccccceeeccccCcceeeeeccCceEEEe
Confidence 99999977666667789999999999999999999999999998 99999999998887765444333366899999875
Q ss_pred e
Q 020784 318 L 318 (321)
Q Consensus 318 ~ 318 (321)
-
T Consensus 692 G 692 (705)
T KOG0639|consen 692 G 692 (705)
T ss_pred c
Confidence 3
No 110
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=99.76 E-value=4e-17 Score=136.54 Aligned_cols=221 Identities=12% Similarity=0.080 Sum_probs=161.4
Q ss_pred CCCCCCeEEEEEcC---CCCEEEEEcCCcEE-EEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCc
Q 020784 82 SSPPPTLLHISFNQ---DHGCFAAGTDHGFR-IYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNK 157 (321)
Q Consensus 82 ~~~~~~V~~v~fs~---dg~~lasg~~~gv~-vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~ 157 (321)
++|..+|..++|+| +|-+|++++.|+-- +-+=+++..+-..+. |.+.|-......+.-.-+.++ .|-+
T Consensus 11 ~ghtrpvvdl~~s~itp~g~flisa~kd~~pmlr~g~tgdwigtfeg-hkgavw~~~l~~na~~aasaa-------adft 82 (334)
T KOG0278|consen 11 HGHTRPVVDLAFSPITPDGYFLISASKDGKPMLRNGDTGDWIGTFEG-HKGAVWSATLNKNATRAASAA-------ADFT 82 (334)
T ss_pred cCCCcceeEEeccCCCCCceEEEEeccCCCchhccCCCCCcEEeeec-cCcceeeeecCchhhhhhhhc-------ccch
Confidence 57788999999985 89999999988743 666678877766665 566665544433322223333 5788
Q ss_pred EEEEeCCCCcEEEEEeeCCceeEEEEeCC---------------------------------------------eEEE-E
Q 020784 158 VMIWDDHQSRCIGELSFRSEVRSVKLRRD---------------------------------------------RIIV-V 191 (321)
Q Consensus 158 v~iWD~~~~~~~~~~~~~~~v~~v~~~~~---------------------------------------------~~~~-~ 191 (321)
.||||.-+|..+..|++...|.+++|+.+ .++. +
T Consensus 83 akvw~a~tgdelhsf~hkhivk~~af~~ds~~lltgg~ekllrvfdln~p~App~E~~ghtg~Ir~v~wc~eD~~iLSSa 162 (334)
T KOG0278|consen 83 AKVWDAVTGDELHSFEHKHIVKAVAFSQDSNYLLTGGQEKLLRVFDLNRPKAPPKEISGHTGGIRTVLWCHEDKCILSSA 162 (334)
T ss_pred hhhhhhhhhhhhhhhhhhheeeeEEecccchhhhccchHHHhhhhhccCCCCCchhhcCCCCcceeEEEeccCceEEeec
Confidence 99999988888888777777777777654 1222 2
Q ss_pred ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCc-ceEEeeccccceeEEEECCCC
Q 020784 192 LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASK-RTKFIMAHDSRIACFALTQDG 270 (321)
Q Consensus 192 ~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~-~~~~l~~H~~~V~~vafspdg 270 (321)
.+++||+||.+++..++++.... ++..+-++.++ .+|.+ ...+.|..||...- .++.++ -.-.|.+..++|+-
T Consensus 163 dd~tVRLWD~rTgt~v~sL~~~s-~VtSlEvs~dG--~ilTi--a~gssV~Fwdaksf~~lKs~k-~P~nV~SASL~P~k 236 (334)
T KOG0278|consen 163 DDKTVRLWDHRTGTEVQSLEFNS-PVTSLEVSQDG--RILTI--AYGSSVKFWDAKSFGLLKSYK-MPCNVESASLHPKK 236 (334)
T ss_pred cCCceEEEEeccCcEEEEEecCC-CCcceeeccCC--CEEEE--ecCceeEEeccccccceeecc-CccccccccccCCC
Confidence 34699999999999999998753 45566666654 66654 45568999997643 333332 23458999999999
Q ss_pred CEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeE--EEeecCceEEE
Q 020784 271 QLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQS--GLWLSSAWLRV 317 (321)
Q Consensus 271 ~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~--~~s~d~~~la~ 317 (321)
..|+.|++|.. ++.||+.||+.+..+..||...+. .|++||..-|.
T Consensus 237 ~~fVaGged~~-~~kfDy~TgeEi~~~nkgh~gpVhcVrFSPdGE~yAs 284 (334)
T KOG0278|consen 237 EFFVAGGEDFK-VYKFDYNTGEEIGSYNKGHFGPVHCVRFSPDGELYAS 284 (334)
T ss_pred ceEEecCcceE-EEEEeccCCceeeecccCCCCceEEEEECCCCceeec
Confidence 99999999999 999999999999988778876654 77888876553
No 111
>KOG0275 consensus Conserved WD40 repeat-containing protein [General function prediction only]
Probab=99.76 E-value=1.3e-17 Score=143.91 Aligned_cols=207 Identities=15% Similarity=0.194 Sum_probs=164.2
Q ss_pred CCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 83 SPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
++...|.|++|+.|...||+|+.|| |+||.+.++.++...+-.|..+|.++.++.++..+..++ .|.++||-
T Consensus 261 Mmd~aVlci~FSRDsEMlAsGsqDGkIKvWri~tG~ClRrFdrAHtkGvt~l~FSrD~SqiLS~s-------fD~tvRiH 333 (508)
T KOG0275|consen 261 MMDDAVLCISFSRDSEMLASGSQDGKIKVWRIETGQCLRRFDRAHTKGVTCLSFSRDNSQILSAS-------FDQTVRIH 333 (508)
T ss_pred ecccceEEEeecccHHHhhccCcCCcEEEEEEecchHHHHhhhhhccCeeEEEEccCcchhhccc-------ccceEEEe
Confidence 5678999999999999999999877 889999999887555433788899999888877776665 78999999
Q ss_pred eCCCCcEEEEEeeCC-ceeEEEEeCC--eEEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEe--eCCCceEEEeec
Q 020784 162 DDHQSRCIGELSFRS-EVRSVKLRRD--RIIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVS--QGVGSLVLVCPG 235 (321)
Q Consensus 162 D~~~~~~~~~~~~~~-~v~~v~~~~~--~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s--~~~d~~~la~sG 235 (321)
-++.|+++.++..++ .|....|..+ .++.+ +|++|++|+..+.+++.+|+.......+..+. |.....+++ +
T Consensus 334 GlKSGK~LKEfrGHsSyvn~a~ft~dG~~iisaSsDgtvkvW~~KtteC~~Tfk~~~~d~~vnsv~~~PKnpeh~iV--C 411 (508)
T KOG0275|consen 334 GLKSGKCLKEFRGHSSYVNEATFTDDGHHIISASSDGTVKVWHGKTTECLSTFKPLGTDYPVNSVILLPKNPEHFIV--C 411 (508)
T ss_pred ccccchhHHHhcCccccccceEEcCCCCeEEEecCCccEEEecCcchhhhhhccCCCCcccceeEEEcCCCCceEEE--E
Confidence 999999999998776 5777888765 34444 56899999999999999998755444333332 322234555 4
Q ss_pred CCCCcEEEEeeCCcceEEeec---cccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeC
Q 020784 236 LQKGQVRVEHYASKRTKFIMA---HDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECC 299 (321)
Q Consensus 236 s~dg~V~i~d~~~~~~~~l~~---H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~ 299 (321)
...++|.|.+++...+..|.. ..+.--+.+.||.|.++-..++|+. +.-|.+.+|++-+++..
T Consensus 412 Nrsntv~imn~qGQvVrsfsSGkREgGdFi~~~lSpkGewiYcigED~v-lYCF~~~sG~LE~tl~V 477 (508)
T KOG0275|consen 412 NRSNTVYIMNMQGQVVRSFSSGKREGGDFINAILSPKGEWIYCIGEDGV-LYCFSVLSGKLERTLPV 477 (508)
T ss_pred cCCCeEEEEeccceEEeeeccCCccCCceEEEEecCCCcEEEEEccCcE-EEEEEeecCceeeeeec
Confidence 677799999988776776653 3455677889999999999999999 99999999999988853
No 112
>KOG0639 consensus Transducin-like enhancer of split protein (contains WD40 repeats) [Chromatin structure and dynamics]
Probab=99.75 E-value=1.2e-16 Score=144.98 Aligned_cols=222 Identities=14% Similarity=0.140 Sum_probs=161.5
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCcEEEEEecCCce---eEEeeee-cCCceEEEEEecCCCeEEEEeCCCCCCCCCCc
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHGFRIYNCDPFRE---IFRRDFE-RGGGIGVVEMLFRCNILALVGGGPDPQYPLNK 157 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~---~~~~~~~-~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~ 157 (321)
..|..-|..++++...+++.+|+.+.|+|||+...+- +....+. .+.-++.+...++++.+++.+ .-.+
T Consensus 416 L~HGEvVcAvtIS~~trhVyTgGkgcVKVWdis~pg~k~PvsqLdcl~rdnyiRSckL~pdgrtLivGG-------east 488 (705)
T KOG0639|consen 416 LAHGEVVCAVTISNPTRHVYTGGKGCVKVWDISQPGNKSPVSQLDCLNRDNYIRSCKLLPDGRTLIVGG-------EAST 488 (705)
T ss_pred hccCcEEEEEEecCCcceeEecCCCeEEEeeccCCCCCCccccccccCcccceeeeEecCCCceEEecc-------ccce
Confidence 4577788889999999999999999999999853321 1111110 244577888889999888776 3478
Q ss_pred EEEEeCCCCcEEEEEeeCC---ceeEEEEeCCe---EEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEE
Q 020784 158 VMIWDDHQSRCIGELSFRS---EVRSVKLRRDR---IIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVL 231 (321)
Q Consensus 158 v~iWD~~~~~~~~~~~~~~---~v~~v~~~~~~---~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~l 231 (321)
|-|||+.........+... .-++++.+++. +.+++++.|+|||+.+..+++.|++|.....++.++.++ .-|
T Consensus 489 lsiWDLAapTprikaeltssapaCyALa~spDakvcFsccsdGnI~vwDLhnq~~VrqfqGhtDGascIdis~dG--tkl 566 (705)
T KOG0639|consen 489 LSIWDLAAPTPRIKAELTSSAPACYALAISPDAKVCFSCCSDGNIAVWDLHNQTLVRQFQGHTDGASCIDISKDG--TKL 566 (705)
T ss_pred eeeeeccCCCcchhhhcCCcchhhhhhhcCCccceeeeeccCCcEEEEEcccceeeecccCCCCCceeEEecCCC--cee
Confidence 9999998665433333322 34556777763 445578999999999999999999998888888888765 445
Q ss_pred EeecCCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeE--EEe
Q 020784 232 VCPGLQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQS--GLW 309 (321)
Q Consensus 232 a~sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~--~~s 309 (321)
= +|+-|.+||-||+..+....-....+.|.++..+|++.+||.|-+.+. |-|-.+.. ..-+.+ .-|+.+++ .|+
T Consensus 567 W-TGGlDntvRcWDlregrqlqqhdF~SQIfSLg~cP~~dWlavGMens~-vevlh~sk-p~kyql-hlheScVLSlKFa 642 (705)
T KOG0639|consen 567 W-TGGLDNTVRCWDLREGRQLQQHDFSSQIFSLGYCPTGDWLAVGMENSN-VEVLHTSK-PEKYQL-HLHESCVLSLKFA 642 (705)
T ss_pred e-cCCCccceeehhhhhhhhhhhhhhhhhheecccCCCccceeeecccCc-EEEEecCC-ccceee-cccccEEEEEEec
Confidence 4 599999999999876543333334678999999999999999988887 65555443 333444 34666665 667
Q ss_pred ecCceEE
Q 020784 310 LSSAWLR 316 (321)
Q Consensus 310 ~d~~~la 316 (321)
.-|+|++
T Consensus 643 ~cGkwfv 649 (705)
T KOG0639|consen 643 YCGKWFV 649 (705)
T ss_pred ccCceee
Confidence 8888875
No 113
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=99.75 E-value=5.1e-17 Score=145.95 Aligned_cols=225 Identities=14% Similarity=0.174 Sum_probs=174.7
Q ss_pred CCCCeEEEEEcCCCC-EEEEEcCCc-EEEEEecCCceeEEeeee--cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 84 PPPTLLHISFNQDHG-CFAAGTDHG-FRIYNCDPFREIFRRDFE--RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~-~lasg~~~g-v~vw~~~~~~~~~~~~~~--~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
..-+|.+++|.|+|. .+++++.+. ...||+.+.+........ ....+...+++++++.+++.+ ..|.|.
T Consensus 256 ~~fPi~~a~f~p~G~~~i~~s~rrky~ysyDle~ak~~k~~~~~g~e~~~~e~FeVShd~~fia~~G-------~~G~I~ 328 (514)
T KOG2055|consen 256 EKFPIQKAEFAPNGHSVIFTSGRRKYLYSYDLETAKVTKLKPPYGVEEKSMERFEVSHDSNFIAIAG-------NNGHIH 328 (514)
T ss_pred ccCccceeeecCCCceEEEecccceEEEEeeccccccccccCCCCcccchhheeEecCCCCeEEEcc-------cCceEE
Confidence 445899999999998 777888766 459999887653222211 123456678889999999988 668999
Q ss_pred EEeCCCCcEEEEEeeCCceeEEEEeCC--eEEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecC
Q 020784 160 IWDDHQSRCIGELSFRSEVRSVKLRRD--RIIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGL 236 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~~~v~~v~~~~~--~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs 236 (321)
+.-..+++.+..++..+.|..++|+.+ .++++ ..+.|.+||+++..+++++..... +.-..++...++.++|+ |+
T Consensus 329 lLhakT~eli~s~KieG~v~~~~fsSdsk~l~~~~~~GeV~v~nl~~~~~~~rf~D~G~-v~gts~~~S~ng~ylA~-GS 406 (514)
T KOG2055|consen 329 LLHAKTKELITSFKIEGVVSDFTFSSDSKELLASGGTGEVYVWNLRQNSCLHRFVDDGS-VHGTSLCISLNGSYLAT-GS 406 (514)
T ss_pred eehhhhhhhhheeeeccEEeeEEEecCCcEEEEEcCCceEEEEecCCcceEEEEeecCc-cceeeeeecCCCceEEe-cc
Confidence 999999999999999999999999754 34443 468999999999999999876433 33344444445589995 99
Q ss_pred CCCcEEEEeeCC-------cceEEeeccccceeEEEECCCCCEEEEEeC--CCcEEEEEEcCCCcEEEEEeCCCc----c
Q 020784 237 QKGQVRVEHYAS-------KRTKFIMAHDSRIACFALTQDGQLLATSST--KGTLVRIFNTLDGTLLQEECCPSI----S 303 (321)
Q Consensus 237 ~dg~V~i~d~~~-------~~~~~l~~H~~~V~~vafspdg~~las~S~--Dgt~IrIWd~~tg~~i~~~~~g~~----~ 303 (321)
..|.|.|||.+. ++++++..-...|+++.|++|+++||.||. +.. +|+=.+.+...+..+...+. .
T Consensus 407 ~~GiVNIYd~~s~~~s~~PkPik~~dNLtt~Itsl~Fn~d~qiLAiaS~~~kna-lrLVHvPS~TVFsNfP~~n~~vg~v 485 (514)
T KOG2055|consen 407 DSGIVNIYDGNSCFASTNPKPIKTVDNLTTAITSLQFNHDAQILAIASRVKKNA-LRLVHVPSCTVFSNFPTSNTKVGHV 485 (514)
T ss_pred CcceEEEeccchhhccCCCCchhhhhhhheeeeeeeeCcchhhhhhhhhccccc-eEEEeccceeeeccCCCCCCcccce
Confidence 999999998542 456677778889999999999999998876 567 99999999888887754433 2
Q ss_pred eeEEEeecCceEEEe
Q 020784 304 AQSGLWLSSAWLRVL 318 (321)
Q Consensus 304 ~~~~~s~d~~~la~~ 318 (321)
..+.||+.|-|||+.
T Consensus 486 tc~aFSP~sG~lAvG 500 (514)
T KOG2055|consen 486 TCMAFSPNSGYLAVG 500 (514)
T ss_pred EEEEecCCCceEEee
Confidence 345888999999985
No 114
>KOG0269 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.75 E-value=8.6e-18 Score=158.95 Aligned_cols=214 Identities=13% Similarity=0.123 Sum_probs=149.9
Q ss_pred CeEEEEEcC-CCCEEEEEcCCc-EEEEEecCC---ceeEEeeeecCCceEEEEEec-CCCeEEEEeCCCCCCCCCCcEEE
Q 020784 87 TLLHISFNQ-DHGCFAAGTDHG-FRIYNCDPF---REIFRRDFERGGGIGVVEMLF-RCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 87 ~V~~v~fs~-dg~~lasg~~~g-v~vw~~~~~---~~~~~~~~~~~~~v~~v~~~~-~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
.+..|.|++ +.++||+++..| |.+||+... +.+....- |...+..++|+. .+++++.++ .|++||+
T Consensus 89 S~~DVkW~~~~~NlIAT~s~nG~i~vWdlnk~~rnk~l~~f~E-H~Rs~~~ldfh~tep~iliSGS-------QDg~vK~ 160 (839)
T KOG0269|consen 89 SAADVKWGQLYSNLIATCSTNGVISVWDLNKSIRNKLLTVFNE-HERSANKLDFHSTEPNILISGS-------QDGTVKC 160 (839)
T ss_pred ehhhcccccchhhhheeecCCCcEEEEecCccccchhhhHhhh-hccceeeeeeccCCccEEEecC-------CCceEEE
Confidence 445567775 567999999977 559999762 22222221 567788888865 455554444 7899999
Q ss_pred EeCCCCcEEEEEeeCC-ceeEEEEeC---CeEEEEEC-CEEEEEEcCC-cEEEEEEeccCCCCceEEEeeCCCceEEEee
Q 020784 161 WDDHQSRCIGELSFRS-EVRSVKLRR---DRIIVVLE-QKIFVYNFAD-LKLLHQIETIANPKGLCAVSQGVGSLVLVCP 234 (321)
Q Consensus 161 WD~~~~~~~~~~~~~~-~v~~v~~~~---~~~~~~~~-~~I~iwd~~~-~~~~~~l~~~~~~~~~~~~s~~~d~~~la~s 234 (321)
||++..+.+.++.... .|..|.|++ +.++.+.+ |.+.+||++. .+...++..|.+++.++.++| ++.+|| +
T Consensus 161 ~DlR~~~S~~t~~~nSESiRDV~fsp~~~~~F~s~~dsG~lqlWDlRqp~r~~~k~~AH~GpV~c~nwhP--nr~~lA-T 237 (839)
T KOG0269|consen 161 WDLRSKKSKSTFRSNSESIRDVKFSPGYGNKFASIHDSGYLQLWDLRQPDRCEKKLTAHNGPVLCLNWHP--NREWLA-T 237 (839)
T ss_pred EeeecccccccccccchhhhceeeccCCCceEEEecCCceEEEeeccCchhHHHHhhcccCceEEEeecC--CCceee-e
Confidence 9999888777766554 799999986 35666655 6999999976 455667788888877777666 668999 5
Q ss_pred cCCCCcEEEEeeCCcceE-Eeec-cccceeEEEECCCC-CEEEEEeC-CCcEEEEEEcCCC-cEEEEEeCCCcceeEEEe
Q 020784 235 GLQKGQVRVEHYASKRTK-FIMA-HDSRIACFALTQDG-QLLATSST-KGTLVRIFNTLDG-TLLQEECCPSISAQSGLW 309 (321)
Q Consensus 235 Gs~dg~V~i~d~~~~~~~-~l~~-H~~~V~~vafspdg-~~las~S~-Dgt~IrIWd~~tg-~~i~~~~~g~~~~~~~~s 309 (321)
|+-|++|+||++.+...+ ...- -..+|.+|+|-|+. .+|||+|. +.+.|+|||++.- -..++|. .|......+.
T Consensus 238 GGRDK~vkiWd~t~~~~~~~~tInTiapv~rVkWRP~~~~hLAtcsmv~dtsV~VWDvrRPYIP~~t~~-eH~~~vt~i~ 316 (839)
T KOG0269|consen 238 GGRDKMVKIWDMTDSRAKPKHTINTIAPVGRVKWRPARSYHLATCSMVVDTSVHVWDVRRPYIPYATFL-EHTDSVTGIA 316 (839)
T ss_pred cCCCccEEEEeccCCCccceeEEeecceeeeeeeccCccchhhhhhccccceEEEEeeccccccceeee-ccCcccccee
Confidence 999999999999854432 2222 24679999999986 46888865 3344999999864 3455664 4444444444
Q ss_pred ecC
Q 020784 310 LSS 312 (321)
Q Consensus 310 ~d~ 312 (321)
|++
T Consensus 317 W~~ 319 (839)
T KOG0269|consen 317 WDS 319 (839)
T ss_pred ccC
Confidence 443
No 115
>KOG0647 consensus mRNA export protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.74 E-value=3.2e-16 Score=134.27 Aligned_cols=195 Identities=14% Similarity=0.124 Sum_probs=144.3
Q ss_pred CCCCCCeEEEEEcC-CCCEEEEEcC-CcEEEEEecCCceeEEe-eeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcE
Q 020784 82 SSPPPTLLHISFNQ-DHGCFAAGTD-HGFRIYNCDPFREIFRR-DFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 82 ~~~~~~V~~v~fs~-dg~~lasg~~-~gv~vw~~~~~~~~~~~-~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
...+..|.+++||| ...+|++|+- ++||+|+++..+...-+ ...|.+++..++|+-++..+++++ .|+.+
T Consensus 24 ~pP~DsIS~l~FSP~~~~~~~A~SWD~tVR~wevq~~g~~~~ka~~~~~~PvL~v~WsddgskVf~g~-------~Dk~~ 96 (347)
T KOG0647|consen 24 NPPEDSISALAFSPQADNLLAAGSWDGTVRIWEVQNSGQLVPKAQQSHDGPVLDVCWSDDGSKVFSGG-------CDKQA 96 (347)
T ss_pred CCcccchheeEeccccCceEEecccCCceEEEEEecCCcccchhhhccCCCeEEEEEccCCceEEeec-------cCCce
Confidence 34456899999999 4455656665 55999999774322111 112689999999999998887777 68999
Q ss_pred EEEeCCCCcEEEEEeeCCceeEEEEeCCeE--EEE---ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEe
Q 020784 159 MIWDDHQSRCIGELSFRSEVRSVKLRRDRI--IVV---LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVC 233 (321)
Q Consensus 159 ~iWD~~~~~~~~~~~~~~~v~~v~~~~~~~--~~~---~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~ 233 (321)
++||+.+++....-.+...|..+.|-+... .++ .|++||+||++....+.+++.... +.+... ...++++
T Consensus 97 k~wDL~S~Q~~~v~~Hd~pvkt~~wv~~~~~~cl~TGSWDKTlKfWD~R~~~pv~t~~LPeR---vYa~Dv--~~pm~vV 171 (347)
T KOG0647|consen 97 KLWDLASGQVSQVAAHDAPVKTCHWVPGMNYQCLVTGSWDKTLKFWDTRSSNPVATLQLPER---VYAADV--LYPMAVV 171 (347)
T ss_pred EEEEccCCCeeeeeecccceeEEEEecCCCcceeEecccccceeecccCCCCeeeeeeccce---eeehhc--cCceeEE
Confidence 999999998776667778999999876543 333 368999999999999988876532 333222 2244553
Q ss_pred ecCCCCcEEEEeeCCcceEEeecc----ccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCC
Q 020784 234 PGLQKGQVRVEHYASKRTKFIMAH----DSRIACFALTQDGQLLATSSTKGTLVRIFNTLDG 291 (321)
Q Consensus 234 sGs~dg~V~i~d~~~~~~~~l~~H----~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg 291 (321)
+..+..|.++++++.+ ..++.| +-.++||+...|....|-||-.|. +-|..+..+
T Consensus 172 -ata~r~i~vynL~n~~-te~k~~~SpLk~Q~R~va~f~d~~~~alGsiEGr-v~iq~id~~ 230 (347)
T KOG0647|consen 172 -ATAERHIAVYNLENPP-TEFKRIESPLKWQTRCVACFQDKDGFALGSIEGR-VAIQYIDDP 230 (347)
T ss_pred -EecCCcEEEEEcCCCc-chhhhhcCcccceeeEEEEEecCCceEeeeecce-EEEEecCCC
Confidence 7888899999986543 333333 345899999999888899999999 999999886
No 116
>KOG0294 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.73 E-value=1e-15 Score=131.91 Aligned_cols=221 Identities=14% Similarity=0.136 Sum_probs=153.4
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCC--eEEEEeCCCCCCCCCCc
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCN--ILALVGGGPDPQYPLNK 157 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~--~~~~~sg~~~~~~~d~~ 157 (321)
...|.+.|++++.+ |.++|+|+. ++|+|||+.........-. |.+.+.++.+.+... .++.++ .||.
T Consensus 39 ~~aH~~sitavAVs--~~~~aSGssDetI~IYDm~k~~qlg~ll~-HagsitaL~F~~~~S~shLlS~s-------dDG~ 108 (362)
T KOG0294|consen 39 FSAHAGSITALAVS--GPYVASGSSDETIHIYDMRKRKQLGILLS-HAGSITALKFYPPLSKSHLLSGS-------DDGH 108 (362)
T ss_pred ccccccceeEEEec--ceeEeccCCCCcEEEEeccchhhhcceec-cccceEEEEecCCcchhheeeec-------CCCc
Confidence 46788999999987 899999986 6799999987765544443 678888888765442 455554 6899
Q ss_pred EEEEeCCCCcEEEEEeeC-CceeEEEEeCCe-EE--EEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEe
Q 020784 158 VMIWDDHQSRCIGELSFR-SEVRSVKLRRDR-II--VVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVC 233 (321)
Q Consensus 158 v~iWD~~~~~~~~~~~~~-~~v~~v~~~~~~-~~--~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~ 233 (321)
|.+|+...-.++..++.+ +.|+.+++||.. ++ +..|+.+|+||+-.|+.-..+..... ...+.+++.+ ..+++
T Consensus 109 i~iw~~~~W~~~~slK~H~~~Vt~lsiHPS~KLALsVg~D~~lr~WNLV~Gr~a~v~~L~~~-at~v~w~~~G--d~F~v 185 (362)
T KOG0294|consen 109 IIIWRVGSWELLKSLKAHKGQVTDLSIHPSGKLALSVGGDQVLRTWNLVRGRVAFVLNLKNK-ATLVSWSPQG--DHFVV 185 (362)
T ss_pred EEEEEcCCeEEeeeecccccccceeEecCCCceEEEEcCCceeeeehhhcCccceeeccCCc-ceeeEEcCCC--CEEEE
Confidence 999999998888888765 479999999864 33 34567999999977765544443322 2345666555 44443
Q ss_pred ecCCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEe----
Q 020784 234 PGLQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLW---- 309 (321)
Q Consensus 234 sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s---- 309 (321)
.+. ..|.||.+.+..+...-.-...+.|+.|- ++.+|++|.+|+. |++||..++.+...+ .+|.+.+-.+.
T Consensus 186 ~~~--~~i~i~q~d~A~v~~~i~~~~r~l~~~~l-~~~~L~vG~d~~~-i~~~D~ds~~~~~~~-~AH~~RVK~i~~~~~ 260 (362)
T KOG0294|consen 186 SGR--NKIDIYQLDNASVFREIENPKRILCATFL-DGSELLVGGDNEW-ISLKDTDSDTPLTEF-LAHENRVKDIASYTN 260 (362)
T ss_pred Eec--cEEEEEecccHhHhhhhhccccceeeeec-CCceEEEecCCce-EEEeccCCCccceee-ecchhheeeeEEEec
Confidence 233 46778876554332111112446777775 4667888999998 999999998888777 46665444332
Q ss_pred ecCceEEEee
Q 020784 310 LSSAWLRVLR 319 (321)
Q Consensus 310 ~d~~~la~~~ 319 (321)
+++.||+.|+
T Consensus 261 ~~~~~lvTaS 270 (362)
T KOG0294|consen 261 PEHEYLVTAS 270 (362)
T ss_pred CCceEEEEec
Confidence 4557887764
No 117
>KOG1274 consensus WD40 repeat protein [General function prediction only]
Probab=99.72 E-value=1.5e-15 Score=146.32 Aligned_cols=226 Identities=13% Similarity=0.073 Sum_probs=163.2
Q ss_pred ccCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCc-eeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCc
Q 020784 80 TSSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFR-EIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNK 157 (321)
Q Consensus 80 ~~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~-~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~ 157 (321)
....|...-+.|+|.++|.+|.+++.++ |++|+..... .--.... ++..+..+ ...++.+++++ .+++
T Consensus 8 lRyaht~G~t~i~~d~~gefi~tcgsdg~ir~~~~~sd~e~P~ti~~-~g~~v~~i--a~~s~~f~~~s-------~~~t 77 (933)
T KOG1274|consen 8 LRYAHTGGLTLICYDPDGEFICTCGSDGDIRKWKTNSDEEEPETIDI-SGELVSSI--ACYSNHFLTGS-------EQNT 77 (933)
T ss_pred chhhccCceEEEEEcCCCCEEEEecCCCceEEeecCCcccCCchhhc-cCceeEEE--eecccceEEee-------ccce
Confidence 3456778899999999999988776655 8899875542 1111111 13334443 34566777777 6899
Q ss_pred EEEEeCCCCcEEEE-EeeCCceeEEEEeCC--eEEEEECC-EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEe
Q 020784 158 VMIWDDHQSRCIGE-LSFRSEVRSVKLRRD--RIIVVLEQ-KIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVC 233 (321)
Q Consensus 158 v~iWD~~~~~~~~~-~~~~~~v~~v~~~~~--~~~~~~~~-~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~ 233 (321)
|.++....++.-.. ..+.-++..++++.+ .++.++++ .|++-++.+.....++.+|..++..+.+. +.+.+||+
T Consensus 78 v~~y~fps~~~~~iL~Rftlp~r~~~v~g~g~~iaagsdD~~vK~~~~~D~s~~~~lrgh~apVl~l~~~--p~~~fLAv 155 (933)
T KOG1274|consen 78 VLRYKFPSGEEDTILARFTLPIRDLAVSGSGKMIAAGSDDTAVKLLNLDDSSQEKVLRGHDAPVLQLSYD--PKGNFLAV 155 (933)
T ss_pred EEEeeCCCCCccceeeeeeccceEEEEecCCcEEEeecCceeEEEEeccccchheeecccCCceeeeeEc--CCCCEEEE
Confidence 99999877654322 123345666777665 56666665 89999999988888999998876665554 55689984
Q ss_pred ecCCCCcEEEEeeCCcce-EEeec-------c-ccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcc-
Q 020784 234 PGLQKGQVRVEHYASKRT-KFIMA-------H-DSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSIS- 303 (321)
Q Consensus 234 sGs~dg~V~i~d~~~~~~-~~l~~-------H-~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~- 303 (321)
.+.||+|+||+++.+.+ +++.+ - .+.+..++|+|+|..||..+.|++ |++++..++.....++..+..
T Consensus 156 -ss~dG~v~iw~~~~~~~~~tl~~v~k~n~~~~s~i~~~~aW~Pk~g~la~~~~d~~-Vkvy~r~~we~~f~Lr~~~~ss 233 (933)
T KOG1274|consen 156 -SSCDGKVQIWDLQDGILSKTLTGVDKDNEFILSRICTRLAWHPKGGTLAVPPVDNT-VKVYSRKGWELQFKLRDKLSSS 233 (933)
T ss_pred -EecCceEEEEEcccchhhhhcccCCccccccccceeeeeeecCCCCeEEeeccCCe-EEEEccCCceeheeeccccccc
Confidence 88899999999987653 33322 1 456788999999888888888999 999999999998888654433
Q ss_pred --eeEEEeecCceEEEee
Q 020784 304 --AQSGLWLSSAWLRVLR 319 (321)
Q Consensus 304 --~~~~~s~d~~~la~~~ 319 (321)
..+++++.|+|||...
T Consensus 234 ~~~~~~wsPnG~YiAAs~ 251 (933)
T KOG1274|consen 234 KFSDLQWSPNGKYIAAST 251 (933)
T ss_pred ceEEEEEcCCCcEEeeec
Confidence 3458899999998753
No 118
>KOG0264 consensus Nucleosome remodeling factor, subunit CAF1/NURF55/MSI1 [Chromatin structure and dynamics]
Probab=99.72 E-value=2.2e-16 Score=141.57 Aligned_cols=198 Identities=15% Similarity=0.184 Sum_probs=144.1
Q ss_pred CCCCCCeEEEEEcCCCC-EEEEEcC-CcEEEEEecCCce-------eEEeeeecCCceEEEEEec-CCCeEEEEeCCCCC
Q 020784 82 SSPPPTLLHISFNQDHG-CFAAGTD-HGFRIYNCDPFRE-------IFRRDFERGGGIGVVEMLF-RCNILALVGGGPDP 151 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~-~lasg~~-~gv~vw~~~~~~~-------~~~~~~~~~~~v~~v~~~~-~~~~~~~~sg~~~~ 151 (321)
.+|...=+.++|++... +|++|++ .++.+||+..... ...... |...|..|+|++ +.+++++++
T Consensus 174 ~gH~~eg~glsWn~~~~g~Lls~~~d~~i~lwdi~~~~~~~~~~~p~~~~~~-h~~~VeDV~~h~~h~~lF~sv~----- 247 (422)
T KOG0264|consen 174 KGHEKEGYGLSWNRQQEGTLLSGSDDHTICLWDINAESKEDKVVDPKTIFSG-HEDVVEDVAWHPLHEDLFGSVG----- 247 (422)
T ss_pred EeecccccccccccccceeEeeccCCCcEEEEeccccccCCccccceEEeec-CCcceehhhccccchhhheeec-----
Confidence 45655677899998532 4555555 6689999865432 111222 677888888865 566777777
Q ss_pred CCCCCcEEEEeCCC--CcEEEEEe-eCCceeEEEEeCC---eEEEEE-CCEEEEEEcCCc-EEEEEEeccCCCCceEEEe
Q 020784 152 QYPLNKVMIWDDHQ--SRCIGELS-FRSEVRSVKLRRD---RIIVVL-EQKIFVYNFADL-KLLHQIETIANPKGLCAVS 223 (321)
Q Consensus 152 ~~~d~~v~iWD~~~--~~~~~~~~-~~~~v~~v~~~~~---~~~~~~-~~~I~iwd~~~~-~~~~~l~~~~~~~~~~~~s 223 (321)
+|+.+.|||.++ .+...... +...|.++.|++. .++.++ |++|++||+|+. +.++++.+|...+..+-++
T Consensus 248 --dd~~L~iwD~R~~~~~~~~~~~ah~~~vn~~~fnp~~~~ilAT~S~D~tV~LwDlRnL~~~lh~~e~H~dev~~V~WS 325 (422)
T KOG0264|consen 248 --DDGKLMIWDTRSNTSKPSHSVKAHSAEVNCVAFNPFNEFILATGSADKTVALWDLRNLNKPLHTFEGHEDEVFQVEWS 325 (422)
T ss_pred --CCCeEEEEEcCCCCCCCcccccccCCceeEEEeCCCCCceEEeccCCCcEEEeechhcccCceeccCCCcceEEEEeC
Confidence 679999999995 34433333 4568999999874 233343 679999999874 5678889998888888888
Q ss_pred eCCCceEEEeecCCCCcEEEEeeCCc---------------ceEEeeccccceeEEEECCCCC-EEEEEeCCCcEEEEEE
Q 020784 224 QGVGSLVLVCPGLQKGQVRVEHYASK---------------RTKFIMAHDSRIACFALTQDGQ-LLATSSTKGTLVRIFN 287 (321)
Q Consensus 224 ~~~d~~~la~sGs~dg~V~i~d~~~~---------------~~~~l~~H~~~V~~vafspdg~-~las~S~Dgt~IrIWd 287 (321)
|+.+ .+|| |++.|+.+.|||+..- .+.+-.||+..|..+.|+|+.. .++|+++|+. ++||+
T Consensus 326 Ph~e-tvLA-SSg~D~rl~vWDls~ig~eq~~eda~dgppEllF~HgGH~~kV~DfsWnp~ePW~I~SvaeDN~-LqIW~ 402 (422)
T KOG0264|consen 326 PHNE-TVLA-SSGTDRRLNVWDLSRIGEEQSPEDAEDGPPELLFIHGGHTAKVSDFSWNPNEPWTIASVAEDNI-LQIWQ 402 (422)
T ss_pred CCCC-ceeE-ecccCCcEEEEeccccccccChhhhccCCcceeEEecCcccccccccCCCCCCeEEEEecCCce-EEEee
Confidence 8754 5677 4668999999997521 1245678999999999999865 6888999998 99999
Q ss_pred cCC
Q 020784 288 TLD 290 (321)
Q Consensus 288 ~~t 290 (321)
...
T Consensus 403 ~s~ 405 (422)
T KOG0264|consen 403 MAE 405 (422)
T ss_pred ccc
Confidence 763
No 119
>KOG0302 consensus Ribosome Assembly protein [General function prediction only]
Probab=99.72 E-value=5e-16 Score=136.56 Aligned_cols=196 Identities=10% Similarity=0.148 Sum_probs=132.9
Q ss_pred CCCCCeEEEEEcCCC--CEEEEEcCCc-EEEEEecC----------------CceeEEeeeecCCceEEEEEecCCCeEE
Q 020784 83 SPPPTLLHISFNQDH--GCFAAGTDHG-FRIYNCDP----------------FREIFRRDFERGGGIGVVEMLFRCNILA 143 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg--~~lasg~~~g-v~vw~~~~----------------~~~~~~~~~~~~~~v~~v~~~~~~~~~~ 143 (321)
.|.+.|+.+.-++-| .+.|+=++.| |.||++.. .+.++.... |++.-..++|++.....
T Consensus 149 ~h~g~~NRvr~~~~~~~~~~aswse~G~V~Vw~l~~~l~~l~~~~~~~~~s~~~Pl~t~~g-hk~EGy~LdWSp~~~g~- 226 (440)
T KOG0302|consen 149 PHYGGINRVRVSRLGNEVLCASWSENGRVQVWDLAPHLNALSEPGLEVKDSEFRPLFTFNG-HKGEGYGLDWSPIKTGR- 226 (440)
T ss_pred ccccccceeeecccCCcceeeeecccCcEEEEEchhhhhhhcCccccccccccCceEEecc-cCccceeeecccccccc-
Confidence 444556666666544 3455555655 78998742 123333333 66667777887733222
Q ss_pred EEeCCCCCCCCCCcEEEEeCCCCcEEEE----EeeCCceeEEEEeCC---eEEEEE-CCEEEEEEcCCc---EEEEEEec
Q 020784 144 LVGGGPDPQYPLNKVMIWDDHQSRCIGE----LSFRSEVRSVKLRRD---RIIVVL-EQKIFVYNFADL---KLLHQIET 212 (321)
Q Consensus 144 ~~sg~~~~~~~d~~v~iWD~~~~~~~~~----~~~~~~v~~v~~~~~---~~~~~~-~~~I~iwd~~~~---~~~~~l~~ 212 (321)
+++|. .-+.|++|...+|..... ..+...|-.++|++. .++.|+ |++|+|||++.+ .++.+ +.
T Consensus 227 LlsGD-----c~~~I~lw~~~~g~W~vd~~Pf~gH~~SVEDLqWSptE~~vfaScS~DgsIrIWDiRs~~~~~~~~~-kA 300 (440)
T KOG0302|consen 227 LLSGD-----CVKGIHLWEPSTGSWKVDQRPFTGHTKSVEDLQWSPTEDGVFASCSCDGSIRIWDIRSGPKKAAVST-KA 300 (440)
T ss_pred cccCc-----cccceEeeeeccCceeecCccccccccchhhhccCCccCceEEeeecCceEEEEEecCCCccceeEe-ec
Confidence 22222 348899999988875432 224457888999763 455564 679999999887 33333 56
Q ss_pred cCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCC----cceEEeeccccceeEEEECCC-CCEEEEEeCCCcEEEEEE
Q 020784 213 IANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYAS----KRTKFIMAHDSRIACFALTQD-GQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 213 ~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~----~~~~~l~~H~~~V~~vafspd-g~~las~S~Dgt~IrIWd 287 (321)
|...+.+++++- .-.+|| +|+.||+++|||++. .++.+|+.|+.+|+||.|+|. ...||.+|.|.. |.|||
T Consensus 301 h~sDVNVISWnr--~~~lLa-sG~DdGt~~iwDLR~~~~~~pVA~fk~Hk~pItsieW~p~e~s~iaasg~D~Q-itiWD 376 (440)
T KOG0302|consen 301 HNSDVNVISWNR--REPLLA-SGGDDGTLSIWDLRQFKSGQPVATFKYHKAPITSIEWHPHEDSVIAASGEDNQ-ITIWD 376 (440)
T ss_pred cCCceeeEEccC--Ccceee-ecCCCceEEEEEhhhccCCCcceeEEeccCCeeEEEeccccCceEEeccCCCc-EEEEE
Confidence 666665555554 446777 699999999999875 345699999999999999986 456777778888 99999
Q ss_pred cCC
Q 020784 288 TLD 290 (321)
Q Consensus 288 ~~t 290 (321)
+.-
T Consensus 377 lsv 379 (440)
T KOG0302|consen 377 LSV 379 (440)
T ss_pred eec
Confidence 874
No 120
>KOG0308 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.72 E-value=2.3e-16 Score=146.91 Aligned_cols=210 Identities=9% Similarity=0.131 Sum_probs=155.8
Q ss_pred CCCCCeEEEEEcCCCCEEEEEcCC-cEEEEEecCCceeEEeeee-cCCceEEEEE-ecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 83 SPPPTLLHISFNQDHGCFAAGTDH-GFRIYNCDPFREIFRRDFE-RGGGIGVVEM-LFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg~~lasg~~~-gv~vw~~~~~~~~~~~~~~-~~~~v~~v~~-~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
.|..=|+.+....+|+.|++++.| +|++|+............+ |..-|.+++. ..+..+++ +|| -|+.|.
T Consensus 71 ~HsDWVNDiiL~~~~~tlIS~SsDtTVK~W~~~~~~~~c~stir~H~DYVkcla~~ak~~~lva--SgG-----LD~~If 143 (735)
T KOG0308|consen 71 HHSDWVNDIILCGNGKTLISASSDTTVKVWNAHKDNTFCMSTIRTHKDYVKCLAYIAKNNELVA--SGG-----LDRKIF 143 (735)
T ss_pred hhHhHHhhHHhhcCCCceEEecCCceEEEeecccCcchhHhhhhcccchheeeeecccCceeEE--ecC-----CCccEE
Confidence 466678888888899888877765 5889998766411111111 6777888887 44444444 444 579999
Q ss_pred EEeCCCC--cEEEEEe----------eCCceeEEEEeCCeEEEEE---CCEEEEEEcCCcEEEEEEeccCCCCceEEEee
Q 020784 160 IWDDHQS--RCIGELS----------FRSEVRSVKLRRDRIIVVL---EQKIFVYNFADLKLLHQIETIANPKGLCAVSQ 224 (321)
Q Consensus 160 iWD~~~~--~~~~~~~----------~~~~v~~v~~~~~~~~~~~---~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~ 224 (321)
|||++++ +.+..+. ....|++++.++....++. .+-+++||.++.+.+.++.+|...+.++.++.
T Consensus 144 lWDin~~~~~l~~s~n~~t~~sl~sG~k~siYSLA~N~t~t~ivsGgtek~lr~wDprt~~kimkLrGHTdNVr~ll~~d 223 (735)
T KOG0308|consen 144 LWDINTGTATLVASFNNVTVNSLGSGPKDSIYSLAMNQTGTIIVSGGTEKDLRLWDPRTCKKIMKLRGHTDNVRVLLVND 223 (735)
T ss_pred EEEccCcchhhhhhccccccccCCCCCccceeeeecCCcceEEEecCcccceEEeccccccceeeeeccccceEEEEEcC
Confidence 9999987 3333322 1236899999987654443 36899999999999999999987777777766
Q ss_pred CCCceEEEeecCCCCcEEEEeeCCc-ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCC-CcEEEEEeCCCc
Q 020784 225 GVGSLVLVCPGLQKGQVRVEHYASK-RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLD-GTLLQEECCPSI 302 (321)
Q Consensus 225 ~~d~~~la~sGs~dg~V~i~d~~~~-~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~t-g~~i~~~~~g~~ 302 (321)
+ |..++ |++.||+|++||+... ++.++..|+..|+++.-+|+-.++.+|+.||. |..=|+++ .++..-++..+.
T Consensus 224 D--Gt~~l-s~sSDgtIrlWdLgqQrCl~T~~vH~e~VWaL~~~~sf~~vYsG~rd~~-i~~Tdl~n~~~~tlick~daP 299 (735)
T KOG0308|consen 224 D--GTRLL-SASSDGTIRLWDLGQQRCLATYIVHKEGVWALQSSPSFTHVYSGGRDGN-IYRTDLRNPAKSTLICKEDAP 299 (735)
T ss_pred C--CCeEe-ecCCCceEEeeeccccceeeeEEeccCceEEEeeCCCcceEEecCCCCc-EEecccCCchhheEeecCCCc
Confidence 4 45565 6999999999999764 58899999999999999999999999999999 88889998 444444544444
Q ss_pred c
Q 020784 303 S 303 (321)
Q Consensus 303 ~ 303 (321)
.
T Consensus 300 v 300 (735)
T KOG0308|consen 300 V 300 (735)
T ss_pred h
Confidence 3
No 121
>KOG1272 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.71 E-value=2.4e-17 Score=148.15 Aligned_cols=210 Identities=16% Similarity=0.191 Sum_probs=169.4
Q ss_pred eEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCC
Q 020784 88 LLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQS 166 (321)
Q Consensus 88 V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~ 166 (321)
=+.+.++.+|++|+.|+.+| +..+|+.+.+..+.... ...|..+.|..+...+|++- .+-+.|||- .|
T Consensus 132 PY~~~ytrnGrhlllgGrKGHlAa~Dw~t~~L~~Ei~v--~Etv~Dv~~LHneq~~AVAQ--------K~y~yvYD~-~G 200 (545)
T KOG1272|consen 132 PYHLDYTRNGRHLLLGGRKGHLAAFDWVTKKLHFEINV--METVRDVTFLHNEQFFAVAQ--------KKYVYVYDN-NG 200 (545)
T ss_pred CeeeeecCCccEEEecCCccceeeeecccceeeeeeeh--hhhhhhhhhhcchHHHHhhh--------hceEEEecC-CC
Confidence 45789999999999999977 67999999988777765 56778888888887777765 467999985 45
Q ss_pred cEEEEEeeCCceeEEEEeCCeEEEEE---CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEE
Q 020784 167 RCIGELSFRSEVRSVKLRRDRIIVVL---EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRV 243 (321)
Q Consensus 167 ~~~~~~~~~~~v~~v~~~~~~~~~~~---~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i 243 (321)
..+..+.....|..+.|-+.++++++ .+.++.-|+..|+++..|.+......+++.+| -+.++- .|..+|+|.+
T Consensus 201 tElHClk~~~~v~rLeFLPyHfLL~~~~~~G~L~Y~DVS~GklVa~~~t~~G~~~vm~qNP--~NaVih-~GhsnGtVSl 277 (545)
T KOG1272|consen 201 TELHCLKRHIRVARLEFLPYHFLLVAASEAGFLKYQDVSTGKLVASIRTGAGRTDVMKQNP--YNAVIH-LGHSNGTVSL 277 (545)
T ss_pred cEEeehhhcCchhhhcccchhheeeecccCCceEEEeechhhhhHHHHccCCccchhhcCC--ccceEE-EcCCCceEEe
Confidence 56667777888999999987655553 26999999999999999988777666666554 446666 5999999999
Q ss_pred EeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecC
Q 020784 244 EHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSS 312 (321)
Q Consensus 244 ~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~ 312 (321)
|.-+.+. +..+..|.++|++||+.++|+|+||.+.|.. ++|||++....+++++.-+....+++|--|
T Consensus 278 WSP~skePLvKiLcH~g~V~siAv~~~G~YMaTtG~Dr~-~kIWDlR~~~ql~t~~tp~~a~~ls~Sqkg 346 (545)
T KOG1272|consen 278 WSPNSKEPLVKILCHRGPVSSIAVDRGGRYMATTGLDRK-VKIWDLRNFYQLHTYRTPHPASNLSLSQKG 346 (545)
T ss_pred cCCCCcchHHHHHhcCCCcceEEECCCCcEEeecccccc-eeEeeeccccccceeecCCCcccccccccc
Confidence 9877654 6678899999999999999999999999999 999999999988888765555555555443
No 122
>KOG1446 consensus Histone H3 (Lys4) methyltransferase complex and RNA cleavage factor II complex, subunit SWD2 [RNA processing and modification; Chromatin structure and dynamics; Posttranslational modification, protein turnover, chaperones]
Probab=99.71 E-value=3.8e-15 Score=128.42 Aligned_cols=194 Identities=11% Similarity=0.158 Sum_probs=148.0
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
.+|...|++++.+|-+..|++|+. ++||+||+...++..... ..+-.++++.+.+-.+|++.++ +.|++
T Consensus 97 ~GH~~~V~sL~~sP~~d~FlS~S~D~tvrLWDlR~~~cqg~l~---~~~~pi~AfDp~GLifA~~~~~-------~~IkL 166 (311)
T KOG1446|consen 97 PGHKKRVNSLSVSPKDDTFLSSSLDKTVRLWDLRVKKCQGLLN---LSGRPIAAFDPEGLIFALANGS-------ELIKL 166 (311)
T ss_pred CCCCceEEEEEecCCCCeEEecccCCeEEeeEecCCCCceEEe---cCCCcceeECCCCcEEEEecCC-------CeEEE
Confidence 578899999999999999998887 579999998776655444 3455667788888888877744 58999
Q ss_pred EeCCCCc--EEEEEeeC----CceeEEEEeCCe--EEEEEC-CEEEEEEcCCcEEEEEEeccCCCCc-eEEEeeCCCceE
Q 020784 161 WDDHQSR--CIGELSFR----SEVRSVKLRRDR--IIVVLE-QKIFVYNFADLKLLHQIETIANPKG-LCAVSQGVGSLV 230 (321)
Q Consensus 161 WD~~~~~--~~~~~~~~----~~v~~v~~~~~~--~~~~~~-~~I~iwd~~~~~~~~~l~~~~~~~~-~~~~s~~~d~~~ 230 (321)
+|++..+ .-.++... .+...+.|++++ +++++. +.+++.|.-+|..++++..+.+... ....++.||+++
T Consensus 167 yD~Rs~dkgPF~tf~i~~~~~~ew~~l~FS~dGK~iLlsT~~s~~~~lDAf~G~~~~tfs~~~~~~~~~~~a~ftPds~F 246 (311)
T KOG1446|consen 167 YDLRSFDKGPFTTFSITDNDEAEWTDLEFSPDGKSILLSTNASFIYLLDAFDGTVKSTFSGYPNAGNLPLSATFTPDSKF 246 (311)
T ss_pred EEecccCCCCceeEccCCCCccceeeeEEcCCCCEEEEEeCCCcEEEEEccCCcEeeeEeeccCCCCcceeEEECCCCcE
Confidence 9998643 33344332 368889998864 555554 5899999999999999988766542 233445556688
Q ss_pred EEeecCCCCcEEEEeeCCcc-eEEeec-cccceeEEEECCCCCEEEEEeCCCcEEEEEEcC
Q 020784 231 LVCPGLQKGQVRVEHYASKR-TKFIMA-HDSRIACFALTQDGQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 231 la~sGs~dg~V~i~d~~~~~-~~~l~~-H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~ 289 (321)
+. +|+.||+|.+|+..++. ...+++ |.+++.|+.|+|....+||++.. +.+|=..
T Consensus 247 vl-~gs~dg~i~vw~~~tg~~v~~~~~~~~~~~~~~~fnP~~~mf~sa~s~---l~fw~p~ 303 (311)
T KOG1446|consen 247 VL-SGSDDGTIHVWNLETGKKVAVLRGPNGGPVSCVRFNPRYAMFVSASSN---LVFWLPD 303 (311)
T ss_pred EE-EecCCCcEEEEEcCCCcEeeEecCCCCCCccccccCCceeeeeecCce---EEEEecc
Confidence 87 59999999999998765 567777 89999999999999999988643 6678543
No 123
>KOG2445 consensus Nuclear pore complex component (sc Seh1) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=99.71 E-value=4.1e-15 Score=127.82 Aligned_cols=209 Identities=16% Similarity=0.220 Sum_probs=137.7
Q ss_pred cccCCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCce----eEEeeeecCCceEEEEEecC--CCeEEEEeCCCCC
Q 020784 79 STSSSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFRE----IFRRDFERGGGIGVVEMLFR--CNILALVGGGPDP 151 (321)
Q Consensus 79 ~~~~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~----~~~~~~~~~~~v~~v~~~~~--~~~~~~~sg~~~~ 151 (321)
++...|..-|.|+.|++-|+++|+++. ..++|||.+.... ...+.. |++.|-.|.|.+. +..+|+++
T Consensus 7 pi~s~h~DlihdVs~D~~GRRmAtCSsDq~vkI~d~~~~s~~W~~Ts~Wra-h~~Si~rV~WAhPEfGqvvA~cS----- 80 (361)
T KOG2445|consen 7 PIDSGHKDLIHDVSFDFYGRRMATCSSDQTVKIWDSTSDSGTWSCTSSWRA-HDGSIWRVVWAHPEFGQVVATCS----- 80 (361)
T ss_pred ccccCCcceeeeeeecccCceeeeccCCCcEEEEeccCCCCceEEeeeEEe-cCCcEEEEEecCccccceEEEEe-----
Confidence 344567789999999999999998887 4589999644332 222333 7888888888653 66778887
Q ss_pred CCCCCcEEEEeCCC-------CcEEEE--E-eeCCceeEEEEeCCe----EEEE-ECCEEEEEEcCC------cEE----
Q 020784 152 QYPLNKVMIWDDHQ-------SRCIGE--L-SFRSEVRSVKLRRDR----IIVV-LEQKIFVYNFAD------LKL---- 206 (321)
Q Consensus 152 ~~~d~~v~iWD~~~-------~~~~~~--~-~~~~~v~~v~~~~~~----~~~~-~~~~I~iwd~~~------~~~---- 206 (321)
.|++++||.-+. .+.+.. + .-.+.|+.|+|.+.+ ++.+ .++.+|||+..+ ..+
T Consensus 81 --~Drtv~iWEE~~~~~~~~~~~Wv~~ttl~DsrssV~DV~FaP~hlGLklA~~~aDG~lRIYEA~dp~nLs~W~Lq~Ei 158 (361)
T KOG2445|consen 81 --YDRTVSIWEEQEKSEEAHGRRWVRRTTLVDSRSSVTDVKFAPKHLGLKLAAASADGILRIYEAPDPMNLSQWTLQHEI 158 (361)
T ss_pred --cCCceeeeeecccccccccceeEEEEEeecCCcceeEEEecchhcceEEEEeccCcEEEEEecCCccccccchhhhhh
Confidence 789999997521 122222 1 224578888887753 2333 346777776421 111
Q ss_pred ---------------------------------------------------------EEEEeccCCCCceEEEeeCCC--
Q 020784 207 ---------------------------------------------------------LHQIETIANPKGLCAVSQGVG-- 227 (321)
Q Consensus 207 ---------------------------------------------------------~~~l~~~~~~~~~~~~s~~~d-- 227 (321)
+.++.++..++.-++++|+-.
T Consensus 159 ~~~~~pp~~~~~~~~CvsWn~sr~~~p~iAvgs~e~a~~~~~~~Iye~~e~~rKw~kva~L~d~~dpI~di~wAPn~Gr~ 238 (361)
T KOG2445|consen 159 QNVIDPPGKNKQPCFCVSWNPSRMHEPLIAVGSDEDAPHLNKVKIYEYNENGRKWLKVAELPDHTDPIRDISWAPNIGRS 238 (361)
T ss_pred hhccCCcccccCcceEEeeccccccCceEEEEcccCCccccceEEEEecCCcceeeeehhcCCCCCcceeeeeccccCCc
Confidence 111223333444455555432
Q ss_pred ceEEEeecCCCCcEEEEeeCCc---------------------ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEE
Q 020784 228 SLVLVCPGLQKGQVRVEHYASK---------------------RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIF 286 (321)
Q Consensus 228 ~~~la~sGs~dg~V~i~d~~~~---------------------~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIW 286 (321)
-.+|| .++.|| |+||.+... .+..+..|++.|..+.|+=.|..|+|.|.||. ||+|
T Consensus 239 y~~lA-vA~kDg-v~I~~v~~~~s~i~~ee~~~~~~~~~l~v~~vs~~~~H~~~VWrv~wNmtGtiLsStGdDG~-VRLW 315 (361)
T KOG2445|consen 239 YHLLA-VATKDG-VRIFKVKVARSAIEEEEVLAPDLMTDLPVEKVSELDDHNGEVWRVRWNMTGTILSSTGDDGC-VRLW 315 (361)
T ss_pred eeeEE-EeecCc-EEEEEEeeccchhhhhcccCCCCccccceEEeeeccCCCCceEEEEEeeeeeEEeecCCCce-eeeh
Confidence 24666 489999 999886521 12357889999999999999999999999999 9999
Q ss_pred EcCC---CcEEEEEe
Q 020784 287 NTLD---GTLLQEEC 298 (321)
Q Consensus 287 d~~t---g~~i~~~~ 298 (321)
...= .+|...++
T Consensus 316 kany~n~~kC~sv~~ 330 (361)
T KOG2445|consen 316 KANYNNLWKCTSVLK 330 (361)
T ss_pred hhhhhhhheeeeEEe
Confidence 7542 34544444
No 124
>KOG1539 consensus WD repeat protein [General function prediction only]
Probab=99.70 E-value=8.3e-16 Score=146.69 Aligned_cols=195 Identities=13% Similarity=0.103 Sum_probs=158.2
Q ss_pred CCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEee--eecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEe
Q 020784 86 PTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRD--FERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWD 162 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~--~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD 162 (321)
..+++|+.++-|++...|..+| |-+||++.+-...... ..|++.|..+++..-...++.++ .+|-++.||
T Consensus 449 ~~~~av~vs~CGNF~~IG~S~G~Id~fNmQSGi~r~sf~~~~ah~~~V~gla~D~~n~~~vsa~-------~~Gilkfw~ 521 (910)
T KOG1539|consen 449 INATAVCVSFCGNFVFIGYSKGTIDRFNMQSGIHRKSFGDSPAHKGEVTGLAVDGTNRLLVSAG-------ADGILKFWD 521 (910)
T ss_pred cceEEEEEeccCceEEEeccCCeEEEEEcccCeeecccccCccccCceeEEEecCCCceEEEcc-------CcceEEEEe
Confidence 6899999999999999998866 6699999885433331 12788999999887777777766 679999999
Q ss_pred CCCCcEEEEEeeCCceeEEEEeCC--eEEEEECC-EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCC
Q 020784 163 DHQSRCIGELSFRSEVRSVKLRRD--RIIVVLEQ-KIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKG 239 (321)
Q Consensus 163 ~~~~~~~~~~~~~~~v~~v~~~~~--~~~~~~~~-~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg 239 (321)
..++..+..+.....+..+..++. .++++.++ .|+++|+.+.+.++.|.+|.+.+..++||+ |+.+|+ +.+.|+
T Consensus 522 f~~k~l~~~l~l~~~~~~iv~hr~s~l~a~~~ddf~I~vvD~~t~kvvR~f~gh~nritd~~FS~--DgrWli-sasmD~ 598 (910)
T KOG1539|consen 522 FKKKVLKKSLRLGSSITGIVYHRVSDLLAIALDDFSIRVVDVVTRKVVREFWGHGNRITDMTFSP--DGRWLI-SASMDS 598 (910)
T ss_pred cCCcceeeeeccCCCcceeeeeehhhhhhhhcCceeEEEEEchhhhhhHHhhccccceeeeEeCC--CCcEEE-EeecCC
Confidence 999998888888888888777754 34555555 999999999999999999988766666665 558888 589999
Q ss_pred cEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 240 QVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 240 ~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
+|++||+-++.+.---.-..+++++.|||+|.+|||...|..-|.+|-=.+
T Consensus 599 tIr~wDlpt~~lID~~~vd~~~~sls~SPngD~LAT~Hvd~~gIylWsNks 649 (910)
T KOG1539|consen 599 TIRTWDLPTGTLIDGLLVDSPCTSLSFSPNGDFLATVHVDQNGIYLWSNKS 649 (910)
T ss_pred cEEEEeccCcceeeeEecCCcceeeEECCCCCEEEEEEecCceEEEEEchh
Confidence 999999988876644456788999999999999999999954499996444
No 125
>KOG0267 consensus Microtubule severing protein katanin p80 subunit B (contains WD40 repeats) [Cell cycle control, cell division, chromosome partitioning]
Probab=99.69 E-value=6.8e-17 Score=151.93 Aligned_cols=188 Identities=14% Similarity=0.199 Sum_probs=149.5
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCC-cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDH-GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~-gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
...|..+|.|+.|+.+..+|++|+.+ +|++||++..+.+..... |...+..+.|++-+.+. ++|. .|..++
T Consensus 66 ~~~hespIeSl~f~~~E~LlaagsasgtiK~wDleeAk~vrtLtg-h~~~~~sv~f~P~~~~~--a~gS-----tdtd~~ 137 (825)
T KOG0267|consen 66 LTGHESPIESLTFDTSERLLAAGSASGTIKVWDLEEAKIVRTLTG-HLLNITSVDFHPYGEFF--ASGS-----TDTDLK 137 (825)
T ss_pred eeccCCcceeeecCcchhhhcccccCCceeeeehhhhhhhhhhhc-cccCcceeeeccceEEe--cccc-----ccccce
Confidence 47899999999999999999999986 588999998887665554 55567777777777666 4444 678999
Q ss_pred EEeCCCCcEEEEEeeCC-ceeEEEEeCCeEEEE--EC-CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeec
Q 020784 160 IWDDHQSRCIGELSFRS-EVRSVKLRRDRIIVV--LE-QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPG 235 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~~-~v~~v~~~~~~~~~~--~~-~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sG 235 (321)
+||.+...|...+..+. -|..+.|.+++-+++ ++ +.++|||+..++++..|.+|...+....+++. ..+++ +|
T Consensus 138 iwD~Rk~Gc~~~~~s~~~vv~~l~lsP~Gr~v~~g~ed~tvki~d~~agk~~~ef~~~e~~v~sle~hp~--e~Lla-~G 214 (825)
T KOG0267|consen 138 IWDIRKKGCSHTYKSHTRVVDVLRLSPDGRWVASGGEDNTVKIWDLTAGKLSKEFKSHEGKVQSLEFHPL--EVLLA-PG 214 (825)
T ss_pred ehhhhccCceeeecCCcceeEEEeecCCCceeeccCCcceeeeecccccccccccccccccccccccCch--hhhhc-cC
Confidence 99999888887777644 466788999875554 33 69999999999999999988877777776554 35555 79
Q ss_pred CCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCC
Q 020784 236 LQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTK 279 (321)
Q Consensus 236 s~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~D 279 (321)
+.|++|++||+.+-. +-..+.....|.+++|+|+|..+++|-.+
T Consensus 215 s~d~tv~f~dletfe~I~s~~~~~~~v~~~~fn~~~~~~~~G~q~ 259 (825)
T KOG0267|consen 215 SSDRTVRFWDLETFEVISSGKPETDGVRSLAFNPDGKIVLSGEQI 259 (825)
T ss_pred CCCceeeeeccceeEEeeccCCccCCceeeeecCCceeeecCchh
Confidence 999999999998544 34566668889999999999999988655
No 126
>KOG0307 consensus Vesicle coat complex COPII, subunit SEC31 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.68 E-value=1.5e-16 Score=156.27 Aligned_cols=224 Identities=13% Similarity=0.164 Sum_probs=156.7
Q ss_pred CCeEEEEEcCCCCE----EEEEcCCc-EEEEEecCC----ce--eEEeeeecCCceEEEEEecCC-CeEEEEeCCCCCCC
Q 020784 86 PTLLHISFNQDHGC----FAAGTDHG-FRIYNCDPF----RE--IFRRDFERGGGIGVVEMLFRC-NILALVGGGPDPQY 153 (321)
Q Consensus 86 ~~V~~v~fs~dg~~----lasg~~~g-v~vw~~~~~----~~--~~~~~~~~~~~v~~v~~~~~~-~~~~~~sg~~~~~~ 153 (321)
.+-+.++|.+.|.. ||.|.+|| |.+||.... +. +..+.- |.|.|..+++.... |.+|.++
T Consensus 65 ~rF~kL~W~~~g~~~~GlIaGG~edG~I~ly~p~~~~~~~~~~~la~~~~-h~G~V~gLDfN~~q~nlLASGa------- 136 (1049)
T KOG0307|consen 65 NRFNKLAWGSYGSHSHGLIAGGLEDGNIVLYDPASIIANASEEVLATKSK-HTGPVLGLDFNPFQGNLLASGA------- 136 (1049)
T ss_pred ccceeeeecccCCCccceeeccccCCceEEecchhhccCcchHHHhhhcc-cCCceeeeeccccCCceeeccC-------
Confidence 36678999998876 78888877 889997653 11 111121 78899999986654 4665544
Q ss_pred CCCcEEEEeCCCCcEEEEE---eeCCceeEEEEeCCe---EEEEEC-CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCC
Q 020784 154 PLNKVMIWDDHQSRCIGEL---SFRSEVRSVKLRRDR---IIVVLE-QKIFVYNFADLKLLHQIETIANPKGLCAVSQGV 226 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~~~---~~~~~v~~v~~~~~~---~~~~~~-~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~ 226 (321)
++|+|.|||+++-+.-... ...+.|.++.|+++. ++.++. +++-|||++..+.+-.+..+.....+..+.+++
T Consensus 137 ~~geI~iWDlnn~~tP~~~~~~~~~~eI~~lsWNrkvqhILAS~s~sg~~~iWDlr~~~pii~ls~~~~~~~~S~l~WhP 216 (1049)
T KOG0307|consen 137 DDGEILIWDLNKPETPFTPGSQAPPSEIKCLSWNRKVSHILASGSPSGRAVIWDLRKKKPIIKLSDTPGRMHCSVLAWHP 216 (1049)
T ss_pred CCCcEEEeccCCcCCCCCCCCCCCcccceEeccchhhhHHhhccCCCCCceeccccCCCcccccccCCCccceeeeeeCC
Confidence 6799999999875432222 234579999999753 444444 599999999888887777665544444555555
Q ss_pred Cc--eEEEeecCCCC-cEEEEeeCC--cceEEeeccccceeEEEECCCC-CEEEEEeCCCcEEEEEEcCCCcEEEEEeCC
Q 020784 227 GS--LVLVCPGLQKG-QVRVEHYAS--KRTKFIMAHDSRIACFALTQDG-QLLATSSTKGTLVRIFNTLDGTLLQEECCP 300 (321)
Q Consensus 227 d~--~~la~sGs~dg-~V~i~d~~~--~~~~~l~~H~~~V~~vafspdg-~~las~S~Dgt~IrIWd~~tg~~i~~~~~g 300 (321)
++ ++++++++..- .|.+||++. .+++++.+|...|.++.|++.+ .+|+|++.|+. |-+||.+||+.+.++-.+
T Consensus 217 ~~aTql~~As~dd~~PviqlWDlR~assP~k~~~~H~~GilslsWc~~D~~lllSsgkD~~-ii~wN~~tgEvl~~~p~~ 295 (1049)
T KOG0307|consen 217 DHATQLLVASGDDSAPVIQLWDLRFASSPLKILEGHQRGILSLSWCPQDPRLLLSSGKDNR-IICWNPNTGEVLGELPAQ 295 (1049)
T ss_pred CCceeeeeecCCCCCceeEeecccccCCchhhhcccccceeeeccCCCCchhhhcccCCCC-eeEecCCCceEeeecCCC
Confidence 54 55654444333 566699775 4578999999999999999766 89999999999 999999999999998653
Q ss_pred Cc-ceeEEEee-cCceEEEe
Q 020784 301 SI-SAQSGLWL-SSAWLRVL 318 (321)
Q Consensus 301 ~~-~~~~~~s~-d~~~la~~ 318 (321)
.+ ...+.+.+ ++..+|+|
T Consensus 296 ~nW~fdv~w~pr~P~~~A~a 315 (1049)
T KOG0307|consen 296 GNWCFDVQWCPRNPSVMAAA 315 (1049)
T ss_pred CcceeeeeecCCCcchhhhh
Confidence 33 44455543 22344443
No 127
>KOG0301 consensus Phospholipase A2-activating protein (contains WD40 repeats) [Lipid transport and metabolism]
Probab=99.68 E-value=1.7e-15 Score=142.14 Aligned_cols=217 Identities=15% Similarity=0.191 Sum_probs=152.5
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeee-cCCceEE-EEEecCCCe-EEEEeCCCCCCCCCCc
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFE-RGGGIGV-VEMLFRCNI-LALVGGGPDPQYPLNK 157 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~-~~~~v~~-v~~~~~~~~-~~~~sg~~~~~~~d~~ 157 (321)
.+|...|+.|++.+.. ++++|++ ++++||+-...+.+-+..+. |.+-+.. ++.....+. +.+.+ .|.+
T Consensus 11 ~gH~~DVr~v~~~~~~-~i~s~sRd~t~~vw~~~~~~~l~~~~~~~~~g~i~~~i~y~e~~~~~l~~g~-------~D~~ 82 (745)
T KOG0301|consen 11 EGHKSDVRAVAVTDGV-CIISGSRDGTVKVWAKKGKQYLETHAFEGPKGFIANSICYAESDKGRLVVGG-------MDTT 82 (745)
T ss_pred ccCccchheeEecCCe-EEeecCCCCceeeeeccCcccccceecccCcceeeccceeccccCcceEeec-------ccce
Confidence 5788889999988866 5666665 56999986544333222221 2333333 333332222 33333 6899
Q ss_pred EEEEeCCCCcEEEEEeeCC-ceeEEEEeCCeEEEE--ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEee
Q 020784 158 VMIWDDHQSRCIGELSFRS-EVRSVKLRRDRIIVV--LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCP 234 (321)
Q Consensus 158 v~iWD~~~~~~~~~~~~~~-~v~~v~~~~~~~~~~--~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~s 234 (321)
|.+|.......+.++..|. .|.++....+..++. .|.++++|-.. ++...+++|...+- ++..-+++ .++ +
T Consensus 83 i~v~~~~~~~P~~~LkgH~snVC~ls~~~~~~~iSgSWD~TakvW~~~--~l~~~l~gH~asVW--Av~~l~e~-~~v-T 156 (745)
T KOG0301|consen 83 IIVFKLSQAEPLYTLKGHKSNVCSLSIGEDGTLISGSWDSTAKVWRIG--ELVYSLQGHTASVW--AVASLPEN-TYV-T 156 (745)
T ss_pred EEEEecCCCCchhhhhccccceeeeecCCcCceEecccccceEEecch--hhhcccCCcchhee--eeeecCCC-cEE-e
Confidence 9999999999888887665 798888766655333 46899999865 45556888866554 44334454 444 6
Q ss_pred cCCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEe--ecC
Q 020784 235 GLQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLW--LSS 312 (321)
Q Consensus 235 Gs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s--~d~ 312 (321)
|+.|++|++|.- .+.+++|.+|...|+.+++-+++. |+|||.||. ||.|++ +|+++.++ .||....-+++ .++
T Consensus 157 gsaDKtIklWk~-~~~l~tf~gHtD~VRgL~vl~~~~-flScsNDg~-Ir~w~~-~ge~l~~~-~ghtn~vYsis~~~~~ 231 (745)
T KOG0301|consen 157 GSADKTIKLWKG-GTLLKTFSGHTDCVRGLAVLDDSH-FLSCSNDGS-IRLWDL-DGEVLLEM-HGHTNFVYSISMALSD 231 (745)
T ss_pred ccCcceeeeccC-CchhhhhccchhheeeeEEecCCC-eEeecCCce-EEEEec-cCceeeee-eccceEEEEEEecCCC
Confidence 999999999975 556889999999999999998765 789999999 999999 88999888 58887665444 555
Q ss_pred ceEEE
Q 020784 313 AWLRV 317 (321)
Q Consensus 313 ~~la~ 317 (321)
+.+..
T Consensus 232 ~~Ivs 236 (745)
T KOG0301|consen 232 GLIVS 236 (745)
T ss_pred CeEEE
Confidence 55543
No 128
>KOG0300 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.68 E-value=3e-15 Score=129.16 Aligned_cols=198 Identities=13% Similarity=0.124 Sum_probs=152.7
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
..+|.+.|.++.|-..|+.+++++- .+..+||+++++.+..... |++....++.++..+++++.+ .|-+.|
T Consensus 268 ltgH~~vV~a~dWL~gg~Q~vTaSWDRTAnlwDVEtge~v~~LtG-Hd~ELtHcstHptQrLVvTsS-------rDtTFR 339 (481)
T KOG0300|consen 268 LTGHRAVVSACDWLAGGQQMVTASWDRTANLWDVETGEVVNILTG-HDSELTHCSTHPTQRLVVTSS-------RDTTFR 339 (481)
T ss_pred eeccccceEehhhhcCcceeeeeeccccceeeeeccCceeccccC-cchhccccccCCcceEEEEec-------cCceeE
Confidence 3568899999999999999999996 5677999999998777776 788888888888887777776 679999
Q ss_pred EEeCCCC-cEEEEEeeCC-ceeEEEEeCCeEE-EEECC-EEEEEEcCCcE-EEEEEeccCCCCceEEEeeCCCceEEEee
Q 020784 160 IWDDHQS-RCIGELSFRS-EVRSVKLRRDRII-VVLEQ-KIFVYNFADLK-LLHQIETIANPKGLCAVSQGVGSLVLVCP 234 (321)
Q Consensus 160 iWD~~~~-~~~~~~~~~~-~v~~v~~~~~~~~-~~~~~-~I~iwd~~~~~-~~~~l~~~~~~~~~~~~s~~~d~~~la~s 234 (321)
+||++.. ..+.-|+.+. .|+++.|..+..+ .++|+ +|++||++++. .+.++... .++.-++++... .++|+
T Consensus 340 LWDFReaI~sV~VFQGHtdtVTS~vF~~dd~vVSgSDDrTvKvWdLrNMRsplATIRtd-S~~NRvavs~g~--~iIAi- 415 (481)
T KOG0300|consen 340 LWDFREAIQSVAVFQGHTDTVTSVVFNTDDRVVSGSDDRTVKVWDLRNMRSPLATIRTD-SPANRVAVSKGH--PIIAI- 415 (481)
T ss_pred eccchhhcceeeeecccccceeEEEEecCCceeecCCCceEEEeeeccccCcceeeecC-CccceeEeecCC--ceEEe-
Confidence 9999843 3455566654 7999999876544 44554 99999998864 35555543 445566776643 78886
Q ss_pred cCCCCcEEEEeeCCcceE-----EeeccccceeEEEECCCC--CEEEEEeCCCcEEEEEEcCCC
Q 020784 235 GLQKGQVRVEHYASKRTK-----FIMAHDSRIACFALTQDG--QLLATSSTKGTLVRIFNTLDG 291 (321)
Q Consensus 235 Gs~dg~V~i~d~~~~~~~-----~l~~H~~~V~~vafspdg--~~las~S~Dgt~IrIWd~~tg 291 (321)
-..+..|+++|++...+. .-++|..-|.|++|..+. .-|.||+.|+. +-=|++.+-
T Consensus 416 PhDNRqvRlfDlnG~RlaRlPrtsRqgHrRMV~c~AW~eehp~cnLftcGFDR~-v~gW~in~p 478 (481)
T KOG0300|consen 416 PHDNRQVRLFDLNGNRLARLPRTSRQGHRRMVTCCAWLEEHPACNLFTCGFDRM-VAGWKINTP 478 (481)
T ss_pred ccCCceEEEEecCCCccccCCcccccccceeeeeeeccccCcccccccccccce-eeeeEeccc
Confidence 666779999999876544 456899999999998553 34778999998 889988753
No 129
>KOG0301 consensus Phospholipase A2-activating protein (contains WD40 repeats) [Lipid transport and metabolism]
Probab=99.67 E-value=5.4e-15 Score=138.74 Aligned_cols=195 Identities=14% Similarity=0.163 Sum_probs=143.8
Q ss_pred CCCCeEE-EEEcC-CCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 84 PPPTLLH-ISFNQ-DHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 84 ~~~~V~~-v~fs~-dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
|.+-|.+ +++-+ |+-.|.+|+.|+ +.+|........+.... |...|+++....++. + ++|+ -|.++||
T Consensus 56 ~~g~i~~~i~y~e~~~~~l~~g~~D~~i~v~~~~~~~P~~~Lkg-H~snVC~ls~~~~~~-~--iSgS-----WD~Takv 126 (745)
T KOG0301|consen 56 PKGFIANSICYAESDKGRLVVGGMDTTIIVFKLSQAEPLYTLKG-HKSNVCSLSIGEDGT-L--ISGS-----WDSTAKV 126 (745)
T ss_pred CcceeeccceeccccCcceEeecccceEEEEecCCCCchhhhhc-cccceeeeecCCcCc-e--Eecc-----cccceEE
Confidence 4444555 66664 444577777766 66999888776665554 666777766544443 3 3433 5799999
Q ss_pred EeCCCCcEEEEEeeC-CceeEEEEeCCeEEEE--ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCC
Q 020784 161 WDDHQSRCIGELSFR-SEVRSVKLRRDRIIVV--LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQ 237 (321)
Q Consensus 161 WD~~~~~~~~~~~~~-~~v~~v~~~~~~~~~~--~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~ 237 (321)
|-. +++...++.| ..|.++..-++..++. .|++||+|.- ++++++|.+|...+.-+++-++ +.++ |++.
T Consensus 127 W~~--~~l~~~l~gH~asVWAv~~l~e~~~vTgsaDKtIklWk~--~~~l~tf~gHtD~VRgL~vl~~--~~fl--ScsN 198 (745)
T KOG0301|consen 127 WRI--GELVYSLQGHTASVWAVASLPENTYVTGSADKTIKLWKG--GTLLKTFSGHTDCVRGLAVLDD--SHFL--SCSN 198 (745)
T ss_pred ecc--hhhhcccCCcchheeeeeecCCCcEEeccCcceeeeccC--CchhhhhccchhheeeeEEecC--CCeE--eecC
Confidence 964 4455556555 4789888766554443 3579999986 6788999999887776666554 2455 5799
Q ss_pred CCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEe
Q 020784 238 KGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEEC 298 (321)
Q Consensus 238 dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~ 298 (321)
||.|+.|++....+..+.+|++.|.+++...++..++|+++|++ +|||+.. +|.+.+.
T Consensus 199 Dg~Ir~w~~~ge~l~~~~ghtn~vYsis~~~~~~~Ivs~gEDrt-lriW~~~--e~~q~I~ 256 (745)
T KOG0301|consen 199 DGSIRLWDLDGEVLLEMHGHTNFVYSISMALSDGLIVSTGEDRT-LRIWKKD--ECVQVIT 256 (745)
T ss_pred CceEEEEeccCceeeeeeccceEEEEEEecCCCCeEEEecCCce-EEEeecC--ceEEEEe
Confidence 99999999988889999999999999998888999999999999 9999977 6666554
No 130
>KOG0270 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.67 E-value=2.1e-15 Score=135.10 Aligned_cols=192 Identities=16% Similarity=0.161 Sum_probs=128.1
Q ss_pred EEEEEcC-------CCCEEEEEcCCc-EEEEEecCCcee-----------------EEeeee---cCCceEEEEEecCCC
Q 020784 89 LHISFNQ-------DHGCFAAGTDHG-FRIYNCDPFREI-----------------FRRDFE---RGGGIGVVEMLFRCN 140 (321)
Q Consensus 89 ~~v~fs~-------dg~~lasg~~~g-v~vw~~~~~~~~-----------------~~~~~~---~~~~v~~v~~~~~~~ 140 (321)
.|+.|-. -|+|+|.|..+. |-|||++-...+ ..+.+. |...+..+.+...-.
T Consensus 177 LC~ewld~~~~~~~~gNyvAiGtmdp~IeIWDLDI~d~v~P~~~LGs~~sk~~~k~~k~~~~~~gHTdavl~Ls~n~~~~ 256 (463)
T KOG0270|consen 177 LCIEWLDHGSKSGGAGNYVAIGTMDPEIEIWDLDIVDAVLPCVTLGSKASKKKKKKGKRSNSASGHTDAVLALSWNRNFR 256 (463)
T ss_pred hhhhhhhcCCCCCCCcceEEEeccCceeEEeccccccccccceeechhhhhhhhhhcccccccccchHHHHHHHhccccc
Confidence 4666643 367999999866 669997522110 001100 222223333322221
Q ss_pred eEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeC-CceeEEEEeCCe---EEEEE-CCEEEEEEcCCcE-EEEEEeccC
Q 020784 141 ILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFR-SEVRSVKLRRDR---IIVVL-EQKIFVYNFADLK-LLHQIETIA 214 (321)
Q Consensus 141 ~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~-~~v~~v~~~~~~---~~~~~-~~~I~iwd~~~~~-~~~~l~~~~ 214 (321)
-++++|+ .|++|++||+.++++...+.++ ..|.++.|++.. ++.++ +++|+++|.+... .-..++..
T Consensus 257 -nVLaSgs-----aD~TV~lWD~~~g~p~~s~~~~~k~Vq~l~wh~~~p~~LLsGs~D~~V~l~D~R~~~~s~~~wk~~- 329 (463)
T KOG0270|consen 257 -NVLASGS-----ADKTVKLWDVDTGKPKSSITHHGKKVQTLEWHPYEPSVLLSGSYDGTVALKDCRDPSNSGKEWKFD- 329 (463)
T ss_pred -eeEEecC-----CCceEEEEEcCCCCcceehhhcCCceeEEEecCCCceEEEeccccceEEeeeccCccccCceEEec-
Confidence 2333443 6899999999999999998854 589999999753 33333 6899999998421 11122221
Q ss_pred CCCceEEEeeCCCceEEEeecCCCCcEEEEeeCC--cceEEeeccccceeEEEECCC-CCEEEEEeCCCcEEEEEEcCC
Q 020784 215 NPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYAS--KRTKFIMAHDSRIACFALTQD-GQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 215 ~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~--~~~~~l~~H~~~V~~vafspd-g~~las~S~Dgt~IrIWd~~t 290 (321)
..+-.+.+.++..+.+++ |..||+|+..|.+. +++.++++|.+.|.+|+++.. -.+|+|+|.|++ |++|++..
T Consensus 330 g~VEkv~w~~~se~~f~~--~tddG~v~~~D~R~~~~~vwt~~AHd~~ISgl~~n~~~p~~l~t~s~d~~-Vklw~~~~ 405 (463)
T KOG0270|consen 330 GEVEKVAWDPHSENSFFV--STDDGTVYYFDIRNPGKPVWTLKAHDDEISGLSVNIQTPGLLSTASTDKV-VKLWKFDV 405 (463)
T ss_pred cceEEEEecCCCceeEEE--ecCCceEEeeecCCCCCceeEEEeccCCcceEEecCCCCcceeeccccce-EEEEeecC
Confidence 234456666665545554 89999999988775 457899999999999999965 468999999999 99999874
No 131
>KOG0270 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.67 E-value=2.1e-15 Score=135.07 Aligned_cols=203 Identities=17% Similarity=0.253 Sum_probs=154.7
Q ss_pred CCCCCeEEEEEcCCC-CEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 83 SPPPTLLHISFNQDH-GCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg-~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
.|...|..++|+.+- ..||+|+. ++|++||+++++......+ |++.|..++|++....+.+.+ + .|++|++
T Consensus 241 gHTdavl~Ls~n~~~~nVLaSgsaD~TV~lWD~~~g~p~~s~~~-~~k~Vq~l~wh~~~p~~LLsG-s-----~D~~V~l 313 (463)
T KOG0270|consen 241 GHTDAVLALSWNRNFRNVLASGSADKTVKLWDVDTGKPKSSITH-HGKKVQTLEWHPYEPSVLLSG-S-----YDGTVAL 313 (463)
T ss_pred cchHHHHHHHhccccceeEEecCCCceEEEEEcCCCCcceehhh-cCCceeEEEecCCCceEEEec-c-----ccceEEe
Confidence 577788899999865 46888886 6699999999998777775 789999999987665554444 2 6899999
Q ss_pred EeCCC-CcEEEEEeeCCceeEEEEeCC---eEEEEE-CCEEEEEEcCCc-EEEEEEeccCCCCceEEEeeCCCceEEEee
Q 020784 161 WDDHQ-SRCIGELSFRSEVRSVKLRRD---RIIVVL-EQKIFVYNFADL-KLLHQIETIANPKGLCAVSQGVGSLVLVCP 234 (321)
Q Consensus 161 WD~~~-~~~~~~~~~~~~v~~v~~~~~---~~~~~~-~~~I~iwd~~~~-~~~~~l~~~~~~~~~~~~s~~~d~~~la~s 234 (321)
.|++. .+.-...++.+.|-.+.|++. .+++.+ +|.++-+|+|+. +++.+++.|..++..++++..-. .+++ +
T Consensus 314 ~D~R~~~~s~~~wk~~g~VEkv~w~~~se~~f~~~tddG~v~~~D~R~~~~~vwt~~AHd~~ISgl~~n~~~p-~~l~-t 391 (463)
T KOG0270|consen 314 KDCRDPSNSGKEWKFDGEVEKVAWDPHSENSFFVSTDDGTVYYFDIRNPGKPVWTLKAHDDEISGLSVNIQTP-GLLS-T 391 (463)
T ss_pred eeccCccccCceEEeccceEEEEecCCCceeEEEecCCceEEeeecCCCCCceeEEEeccCCcceEEecCCCC-ccee-e
Confidence 99984 344556788889999999764 344555 479999999875 99999999999888877765432 3455 5
Q ss_pred cCCCCcEEEEeeCCcceEEeeccc---cceeEEEECCCC-CEEEEEeCCCcEEEEEEcCCCcEEE
Q 020784 235 GLQKGQVRVEHYASKRTKFIMAHD---SRIACFALTQDG-QLLATSSTKGTLVRIFNTLDGTLLQ 295 (321)
Q Consensus 235 Gs~dg~V~i~d~~~~~~~~l~~H~---~~V~~vafspdg-~~las~S~Dgt~IrIWd~~tg~~i~ 295 (321)
++.|+.|++|++....-+....|. +...|.++.|+- ..||.|+..+. +||||+.+...++
T Consensus 392 ~s~d~~Vklw~~~~~~~~~v~~~~~~~~rl~c~~~~~~~a~~la~GG~k~~-~~vwd~~~~~~V~ 455 (463)
T KOG0270|consen 392 ASTDKVVKLWKFDVDSPKSVKEHSFKLGRLHCFALDPDVAFTLAFGGEKAV-LRVWDIFTNSPVR 455 (463)
T ss_pred ccccceEEEEeecCCCCcccccccccccceeecccCCCcceEEEecCccce-EEEeecccChhHH
Confidence 999999999998765444444443 335677777774 46788888886 9999999876553
No 132
>KOG1007 consensus WD repeat protein TSSC1, WD repeat superfamily [Function unknown]
Probab=99.66 E-value=3.7e-15 Score=127.16 Aligned_cols=195 Identities=12% Similarity=0.121 Sum_probs=141.7
Q ss_pred CCCCeEEEEEcCCCCEEEEEcCCcEEEEEecCCcee-EEee----eecCCceEEEEEec--CCCeEEEEeCCCCCCCCCC
Q 020784 84 PPPTLLHISFNQDHGCFAAGTDHGFRIYNCDPFREI-FRRD----FERGGGIGVVEMLF--RCNILALVGGGPDPQYPLN 156 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~-~~~~----~~~~~~v~~v~~~~--~~~~~~~~sg~~~~~~~d~ 156 (321)
+-++|.||.|.|++..||+-.+..|.+|+++....+ .... ..+......-.|++ +++.+++.+ |+
T Consensus 122 avg~i~cvew~Pns~klasm~dn~i~l~~l~ess~~vaev~ss~s~e~~~~ftsg~WspHHdgnqv~tt~--------d~ 193 (370)
T KOG1007|consen 122 AVGKINCVEWEPNSDKLASMDDNNIVLWSLDESSKIVAEVLSSESAEMRHSFTSGAWSPHHDGNQVATTS--------DS 193 (370)
T ss_pred HhCceeeEEEcCCCCeeEEeccCceEEEEcccCcchheeecccccccccceecccccCCCCccceEEEeC--------CC
Confidence 335899999999999999998999999999876542 1111 00123344445655 567777765 68
Q ss_pred cEEEEeCCCCcEEEEEe--eCCceeEEEEeCCe---EEEEEC-CEEEEEEcCC-cEEEEEEeccCCCCceEEEeeCCCce
Q 020784 157 KVMIWDDHQSRCIGELS--FRSEVRSVKLRRDR---IIVVLE-QKIFVYNFAD-LKLLHQIETIANPKGLCAVSQGVGSL 229 (321)
Q Consensus 157 ~v~iWD~~~~~~~~~~~--~~~~v~~v~~~~~~---~~~~~~-~~I~iwd~~~-~~~~~~l~~~~~~~~~~~~s~~~d~~ 229 (321)
+++.||+++.++...+. +...|..+.|++++ ++.|.| ++|||||.+. ...++.+..|.+++-.+.|++..|..
T Consensus 194 tl~~~D~RT~~~~~sI~dAHgq~vrdlDfNpnkq~~lvt~gDdgyvriWD~R~tk~pv~el~~HsHWvW~VRfn~~hdqL 273 (370)
T KOG1007|consen 194 TLQFWDLRTMKKNNSIEDAHGQRVRDLDFNPNKQHILVTCGDDGYVRIWDTRKTKFPVQELPGHSHWVWAVRFNPEHDQL 273 (370)
T ss_pred cEEEEEccchhhhcchhhhhcceeeeccCCCCceEEEEEcCCCccEEEEeccCCCccccccCCCceEEEEEEecCccceE
Confidence 99999999887666554 33469999999874 344444 6999999975 56678888898888888887776644
Q ss_pred EEEeecCCCCcEEEEeeC------------------------------CcceEEeeccccceeEEEECC-CCCEEEEEeC
Q 020784 230 VLVCPGLQKGQVRVEHYA------------------------------SKRTKFIMAHDSRIACFALTQ-DGQLLATSST 278 (321)
Q Consensus 230 ~la~sGs~dg~V~i~d~~------------------------------~~~~~~l~~H~~~V~~vafsp-dg~~las~S~ 278 (321)
+| +|+.|..|.+|-.. .+.+.++..|...|++++||. |-=+||+-|+
T Consensus 274 iL--s~~SDs~V~Lsca~svSSE~qi~~~~dese~e~~dseer~kpL~dg~l~tydehEDSVY~~aWSsadPWiFASLSY 351 (370)
T KOG1007|consen 274 IL--SGGSDSAVNLSCASSVSSEQQIEFEDDESESEDEDSEERVKPLQDGQLETYDEHEDSVYALAWSSADPWIFASLSY 351 (370)
T ss_pred EE--ecCCCceeEEEeccccccccccccccccccCcchhhHHhcccccccccccccccccceEEEeeccCCCeeEEEecc
Confidence 33 68888888886421 223447888999999999984 5568999999
Q ss_pred CCcEEEEEEcC
Q 020784 279 KGTLVRIFNTL 289 (321)
Q Consensus 279 Dgt~IrIWd~~ 289 (321)
||. +-|=++.
T Consensus 352 DGR-viIs~V~ 361 (370)
T KOG1007|consen 352 DGR-VIISSVP 361 (370)
T ss_pred Cce-EEeecCC
Confidence 999 6554443
No 133
>KOG0646 consensus WD40 repeat protein [General function prediction only]
Probab=99.66 E-value=3.7e-15 Score=134.24 Aligned_cols=190 Identities=14% Similarity=0.133 Sum_probs=137.1
Q ss_pred CCCCCCCCCCcccCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecC---------CceeEEeeeecCCceEEEEEecC
Q 020784 69 YQMPLPSPAESTSSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDP---------FREIFRRDFERGGGIGVVEMLFR 138 (321)
Q Consensus 69 ~~~~~~~~~~~~~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~---------~~~~~~~~~~~~~~v~~v~~~~~ 138 (321)
.|.........+...|=..|+|+.|+-||.+|++|+.|| |.+|.+.. .+.++.+.. |.=.|..+.+.+.
T Consensus 107 lWelssG~LL~v~~aHYQ~ITcL~fs~dgs~iiTgskDg~V~vW~l~~lv~a~~~~~~~p~~~f~~-HtlsITDl~ig~G 185 (476)
T KOG0646|consen 107 LWELSSGILLNVLSAHYQSITCLKFSDDGSHIITGSKDGAVLVWLLTDLVSADNDHSVKPLHIFSD-HTLSITDLQIGSG 185 (476)
T ss_pred EEEeccccHHHHHHhhccceeEEEEeCCCcEEEecCCCccEEEEEEEeecccccCCCccceeeecc-CcceeEEEEecCC
Confidence 444444444444467778999999999999999999988 77997621 122222221 3445666666554
Q ss_pred C--CeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCC--eEEEEE-CCEEEEEEcCC----------
Q 020784 139 C--NILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRD--RIIVVL-EQKIFVYNFAD---------- 203 (321)
Q Consensus 139 ~--~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~--~~~~~~-~~~I~iwd~~~---------- 203 (321)
+ ..+++++ .|+++|+||+..+..+.++.++..+.++.+.+- .+++++ ++.|.+.++.+
T Consensus 186 g~~~rl~TaS-------~D~t~k~wdlS~g~LLlti~fp~si~av~lDpae~~~yiGt~~G~I~~~~~~~~~~~~~~v~~ 258 (476)
T KOG0646|consen 186 GTNARLYTAS-------EDRTIKLWDLSLGVLLLTITFPSSIKAVALDPAERVVYIGTEEGKIFQNLLFKLSGQSAGVNQ 258 (476)
T ss_pred CccceEEEec-------CCceEEEEEeccceeeEEEecCCcceeEEEcccccEEEecCCcceEEeeehhcCCcccccccc
Confidence 2 3455555 789999999999999999999999999998863 455654 46777777643
Q ss_pred ------cEEEEEEeccCC--CCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCC
Q 020784 204 ------LKLLHQIETIAN--PKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQD 269 (321)
Q Consensus 204 ------~~~~~~l~~~~~--~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspd 269 (321)
+..+..+.+|.+ .+.+.+++.+ +.+|+ ||+.||.|+|||...++ ++++..-.++|+.+.+.|=
T Consensus 259 k~~~~~~t~~~~~~Gh~~~~~ITcLais~D--gtlLl-SGd~dg~VcvWdi~S~Q~iRtl~~~kgpVtnL~i~~~ 330 (476)
T KOG0646|consen 259 KGRHEENTQINVLVGHENESAITCLAISTD--GTLLL-SGDEDGKVCVWDIYSKQCIRTLQTSKGPVTNLQINPL 330 (476)
T ss_pred cccccccceeeeeccccCCcceeEEEEecC--ccEEE-eeCCCCCEEEEecchHHHHHHHhhhccccceeEeecc
Confidence 234556677777 5666667665 58888 69999999999998876 5566657889999999654
No 134
>KOG4328 consensus WD40 protein [Function unknown]
Probab=99.66 E-value=6.3e-15 Score=132.50 Aligned_cols=227 Identities=11% Similarity=0.099 Sum_probs=145.1
Q ss_pred CCCCCCeEEEEEcCCC--CEEEEEcCCc-EEEEEecCCce----eEEeeeecCCceEEEEEecCC-CeEEEEeCCCCCCC
Q 020784 82 SSPPPTLLHISFNQDH--GCFAAGTDHG-FRIYNCDPFRE----IFRRDFERGGGIGVVEMLFRC-NILALVGGGPDPQY 153 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg--~~lasg~~~g-v~vw~~~~~~~----~~~~~~~~~~~v~~v~~~~~~-~~~~~~sg~~~~~~ 153 (321)
+.+..+|++++|+|.. +++|+|+..| |-+||+.+.+. ++...- |.+.|..+.+.+.. +.+...+
T Consensus 183 kv~~~Rit~l~fHPt~~~~lva~GdK~G~VG~Wn~~~~~~d~d~v~~f~~-hs~~Vs~l~F~P~n~s~i~ssS------- 254 (498)
T KOG4328|consen 183 KVTDRRITSLAFHPTENRKLVAVGDKGGQVGLWNFGTQEKDKDGVYLFTP-HSGPVSGLKFSPANTSQIYSSS------- 254 (498)
T ss_pred EecccceEEEEecccCcceEEEEccCCCcEEEEecCCCCCccCceEEecc-CCccccceEecCCChhheeeec-------
Confidence 3456799999999965 4677777755 77999952221 111221 67789999988754 4444444
Q ss_pred CCCcEEEEeCCCCcE--EEEEeeCC-ceeEEEEeCC-eEEEEEC--CEEEEEEcCCcEE-EEEEeccCCCCceEEEeeCC
Q 020784 154 PLNKVMIWDDHQSRC--IGELSFRS-EVRSVKLRRD-RIIVVLE--QKIFVYNFADLKL-LHQIETIANPKGLCAVSQGV 226 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~--~~~~~~~~-~v~~v~~~~~-~~~~~~~--~~I~iwd~~~~~~-~~~l~~~~~~~~~~~~s~~~ 226 (321)
.||+||.-|++++.. +...+... ....+.|..+ ..++..+ +...+||++..+. ...+..|...+..++++|-.
T Consensus 255 yDGtiR~~D~~~~i~e~v~s~~~d~~~fs~~d~~~e~~~vl~~~~~G~f~~iD~R~~~s~~~~~~lh~kKI~sv~~NP~~ 334 (498)
T KOG4328|consen 255 YDGTIRLQDFEGNISEEVLSLDTDNIWFSSLDFSAESRSVLFGDNVGNFNVIDLRTDGSEYENLRLHKKKITSVALNPVC 334 (498)
T ss_pred cCceeeeeeecchhhHHHhhcCccceeeeeccccCCCccEEEeecccceEEEEeecCCccchhhhhhhcccceeecCCCC
Confidence 689999999987642 22222121 2344555543 2333333 5789999976543 44555666655556665543
Q ss_pred CceEEEeecCCCCcEEEEeeCC---cc--eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcC----C----CcE
Q 020784 227 GSLVLVCPGLQKGQVRVEHYAS---KR--TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTL----D----GTL 293 (321)
Q Consensus 227 d~~~la~sGs~dg~V~i~d~~~---~~--~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~----t----g~~ 293 (321)
. .++| +++.|++++|||+.. +. +.....|...|.+..|||+|..|+|-+.|.. |||||.. . +..
T Consensus 335 p-~~la-T~s~D~T~kIWD~R~l~~K~sp~lst~~HrrsV~sAyFSPs~gtl~TT~~D~~-IRv~dss~~sa~~~p~~~I 411 (498)
T KOG4328|consen 335 P-WFLA-TASLDQTAKIWDLRQLRGKASPFLSTLPHRRSVNSAYFSPSGGTLLTTCQDNE-IRVFDSSCISAKDEPLGTI 411 (498)
T ss_pred c-hhee-ecccCcceeeeehhhhcCCCCcceecccccceeeeeEEcCCCCceEeeccCCc-eEEeecccccccCCcccee
Confidence 2 3444 699999999999863 22 3445679999999999999888999999999 9999984 2 222
Q ss_pred EEEEeCCCcceeEEEeecC--ceEEEee
Q 020784 294 LQEECCPSISAQSGLWLSS--AWLRVLR 319 (321)
Q Consensus 294 i~~~~~g~~~~~~~~s~d~--~~la~~~ 319 (321)
.+....|.....+...|++ .+++++|
T Consensus 412 ~Hn~~t~RwlT~fKA~W~P~~~li~vg~ 439 (498)
T KOG4328|consen 412 PHNNRTGRWLTPFKAAWDPDYNLIVVGR 439 (498)
T ss_pred eccCcccccccchhheeCCCccEEEEec
Confidence 2322233333334334444 6676664
No 135
>KOG0268 consensus Sof1-like rRNA processing protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.66 E-value=2.1e-15 Score=132.04 Aligned_cols=199 Identities=15% Similarity=0.240 Sum_probs=134.1
Q ss_pred cccCCCCCCeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcE
Q 020784 79 STSSSPPPTLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 79 ~~~~~~~~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
.....|.+.|+.|+++. +.+|.+|.+++|+.|.++-. ....... +..+..+..+...+.++++| ..|
T Consensus 103 ~~f~AH~G~V~Gi~v~~-~~~~tvgdDKtvK~wk~~~~-p~~tilg--~s~~~gIdh~~~~~~FaTcG---------e~i 169 (433)
T KOG0268|consen 103 RTFKAHEGLVRGICVTQ-TSFFTVGDDKTVKQWKIDGP-PLHTILG--KSVYLGIDHHRKNSVFATCG---------EQI 169 (433)
T ss_pred heeecccCceeeEEecc-cceEEecCCcceeeeeccCC-cceeeec--cccccccccccccccccccC---------cee
Confidence 34467889999999999 77888888899999987542 2222221 34455555555566666655 568
Q ss_pred EEEeCCCCcEEEEEeeCC-ceeEEEEeCC---eEEEE-ECCEEEEEEcCCcEEEEEEeccCC------------------
Q 020784 159 MIWDDHQSRCIGELSFRS-EVRSVKLRRD---RIIVV-LEQKIFVYNFADLKLLHQIETIAN------------------ 215 (321)
Q Consensus 159 ~iWD~~~~~~~~~~~~~~-~v~~v~~~~~---~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~------------------ 215 (321)
-|||.+....+..+.... .+.++.|++- .+++| .|+.|.+||+++.+.++++.....
T Consensus 170 ~IWD~~R~~Pv~smswG~Dti~svkfNpvETsILas~~sDrsIvLyD~R~~~Pl~KVi~~mRTN~IswnPeafnF~~a~E 249 (433)
T KOG0268|consen 170 DIWDEQRDNPVSSMSWGADSISSVKFNPVETSILASCASDRSIVLYDLRQASPLKKVILTMRTNTICWNPEAFNFVAANE 249 (433)
T ss_pred eecccccCCccceeecCCCceeEEecCCCcchheeeeccCCceEEEecccCCccceeeeeccccceecCccccceeeccc
Confidence 888887777777666554 5777777763 34444 456888888877766665421110
Q ss_pred ----------------------CCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceE-Ee-eccccceeEEEECCCCC
Q 020784 216 ----------------------PKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTK-FI-MAHDSRIACFALTQDGQ 271 (321)
Q Consensus 216 ----------------------~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~-~l-~~H~~~V~~vafspdg~ 271 (321)
...++++.++|.|.-++ +|+.|++|+|+....+... ++ ..-...|.||.||-|.+
T Consensus 250 D~nlY~~DmR~l~~p~~v~~dhvsAV~dVdfsptG~Efv-sgsyDksIRIf~~~~~~SRdiYhtkRMq~V~~Vk~S~Dsk 328 (433)
T KOG0268|consen 250 DHNLYTYDMRNLSRPLNVHKDHVSAVMDVDFSPTGQEFV-SGSYDKSIRIFPVNHGHSRDIYHTKRMQHVFCVKYSMDSK 328 (433)
T ss_pred cccceehhhhhhcccchhhcccceeEEEeccCCCcchhc-cccccceEEEeecCCCcchhhhhHhhhheeeEEEEecccc
Confidence 01244555555567777 6999999999887643221 11 11234699999999999
Q ss_pred EEEEEeCCCcEEEEEEcCCCc
Q 020784 272 LLATSSTKGTLVRIFNTLDGT 292 (321)
Q Consensus 272 ~las~S~Dgt~IrIWd~~tg~ 292 (321)
+++|||+|+. ||+|.....+
T Consensus 329 yi~SGSdd~n-vRlWka~Ase 348 (433)
T KOG0268|consen 329 YIISGSDDGN-VRLWKAKASE 348 (433)
T ss_pred EEEecCCCcc-eeeeecchhh
Confidence 9999999999 9999876543
No 136
>KOG1274 consensus WD40 repeat protein [General function prediction only]
Probab=99.64 E-value=1.7e-14 Score=139.15 Aligned_cols=176 Identities=13% Similarity=0.132 Sum_probs=140.0
Q ss_pred CCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC
Q 020784 86 PTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH 164 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~ 164 (321)
-++++++|+-+|+++|.|++|. |++-+++....+.+... |+++|.++.+.+.++.+|+++ .||+|+|||++
T Consensus 97 lp~r~~~v~g~g~~iaagsdD~~vK~~~~~D~s~~~~lrg-h~apVl~l~~~p~~~fLAvss-------~dG~v~iw~~~ 168 (933)
T KOG1274|consen 97 LPIRDLAVSGSGKMIAAGSDDTAVKLLNLDDSSQEKVLRG-HDAPVLQLSYDPKGNFLAVSS-------CDGKVQIWDLQ 168 (933)
T ss_pred ccceEEEEecCCcEEEeecCceeEEEEeccccchheeecc-cCCceeeeeEcCCCCEEEEEe-------cCceEEEEEcc
Confidence 3899999999999999999976 88999987776655554 789999999999999999988 67999999999
Q ss_pred CCcEEEEEee---------CCceeEEEEeCC---eEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEE
Q 020784 165 QSRCIGELSF---------RSEVRSVKLRRD---RIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLV 232 (321)
Q Consensus 165 ~~~~~~~~~~---------~~~v~~v~~~~~---~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la 232 (321)
++.+..++.. ...+..++|+++ .++.+.++.|++|+..+++...++.........+.+.+.|.|.+||
T Consensus 169 ~~~~~~tl~~v~k~n~~~~s~i~~~~aW~Pk~g~la~~~~d~~Vkvy~r~~we~~f~Lr~~~~ss~~~~~~wsPnG~YiA 248 (933)
T KOG1274|consen 169 DGILSKTLTGVDKDNEFILSRICTRLAWHPKGGTLAVPPVDNTVKVYSRKGWELQFKLRDKLSSSKFSDLQWSPNGKYIA 248 (933)
T ss_pred cchhhhhcccCCccccccccceeeeeeecCCCCeEEeeccCCeEEEEccCCceeheeecccccccceEEEEEcCCCcEEe
Confidence 9887665432 224566889987 3445578999999999999888887644444466666677789999
Q ss_pred eecCCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEE
Q 020784 233 CPGLQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLL 273 (321)
Q Consensus 233 ~sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~l 273 (321)
+ ++.||.|.|||..+... ......|.|++|.|++.-+
T Consensus 249 A-s~~~g~I~vWnv~t~~~---~~~~~~Vc~~aw~p~~n~i 285 (933)
T KOG1274|consen 249 A-STLDGQILVWNVDTHER---HEFKRAVCCEAWKPNANAI 285 (933)
T ss_pred e-eccCCcEEEEecccchh---ccccceeEEEecCCCCCee
Confidence 5 99999999999876222 3335679999999997644
No 137
>KOG0293 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.64 E-value=1.1e-14 Score=129.52 Aligned_cols=181 Identities=14% Similarity=0.165 Sum_probs=129.9
Q ss_pred cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCC---cEEEEEee-CCceeEEEEeCCe--EEEE-ECCEEEE
Q 020784 126 RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQS---RCIGELSF-RSEVRSVKLRRDR--IIVV-LEQKIFV 198 (321)
Q Consensus 126 ~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~---~~~~~~~~-~~~v~~v~~~~~~--~~~~-~~~~I~i 198 (321)
|...|-.+.+++++.++|+++ .|.+..||++... +...++.. ..+|.-+.|+|+. ++.| .+..+++
T Consensus 223 htdEVWfl~FS~nGkyLAsaS-------kD~Taiiw~v~~d~~~kl~~tlvgh~~~V~yi~wSPDdryLlaCg~~e~~~l 295 (519)
T KOG0293|consen 223 HTDEVWFLQFSHNGKYLASAS-------KDSTAIIWIVVYDVHFKLKKTLVGHSQPVSYIMWSPDDRYLLACGFDEVLSL 295 (519)
T ss_pred CCCcEEEEEEcCCCeeEeecc-------CCceEEEEEEecCcceeeeeeeecccCceEEEEECCCCCeEEecCchHheee
Confidence 577899999999999999988 7899999987533 23445544 4589999999973 4444 3468999
Q ss_pred EEcCCcEEEEEEecc-CCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEEeecc--------------------
Q 020784 199 YNFADLKLLHQIETI-ANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKFIMAH-------------------- 257 (321)
Q Consensus 199 wd~~~~~~~~~l~~~-~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~H-------------------- 257 (321)
||..++++.+.+... .....+|++.|+ +.-+++ |+.|+.|..||.....+...++-
T Consensus 296 wDv~tgd~~~~y~~~~~~S~~sc~W~pD--g~~~V~-Gs~dr~i~~wdlDgn~~~~W~gvr~~~v~dlait~Dgk~vl~v 372 (519)
T KOG0293|consen 296 WDVDTGDLRHLYPSGLGFSVSSCAWCPD--GFRFVT-GSPDRTIIMWDLDGNILGNWEGVRDPKVHDLAITYDGKYVLLV 372 (519)
T ss_pred ccCCcchhhhhcccCcCCCcceeEEccC--CceeEe-cCCCCcEEEecCCcchhhcccccccceeEEEEEcCCCcEEEEE
Confidence 999999998888654 344556666665 466664 99999998888653322222111
Q ss_pred ----------------------ccceeEEEECCCCCEE------------------------------------------
Q 020784 258 ----------------------DSRIACFALTQDGQLL------------------------------------------ 273 (321)
Q Consensus 258 ----------------------~~~V~~vafspdg~~l------------------------------------------ 273 (321)
..+|++.++|.||+++
T Consensus 373 ~~d~~i~l~~~e~~~dr~lise~~~its~~iS~d~k~~LvnL~~qei~LWDl~e~~lv~kY~Ghkq~~fiIrSCFgg~~~ 452 (519)
T KOG0293|consen 373 TVDKKIRLYNREARVDRGLISEEQPITSFSISKDGKLALVNLQDQEIHLWDLEENKLVRKYFGHKQGHFIIRSCFGGGND 452 (519)
T ss_pred ecccceeeechhhhhhhccccccCceeEEEEcCCCcEEEEEcccCeeEEeecchhhHHHHhhcccccceEEEeccCCCCc
Confidence 1234444444444433
Q ss_pred ---EEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecC---ceEEEe
Q 020784 274 ---ATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSS---AWLRVL 318 (321)
Q Consensus 274 ---as~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~---~~la~~ 318 (321)
||||+|+. |+||+..+|+++.++ .||..+..++++++ ..+|-|
T Consensus 453 ~fiaSGSED~k-vyIWhr~sgkll~~L-sGHs~~vNcVswNP~~p~m~ASa 501 (519)
T KOG0293|consen 453 KFIASGSEDSK-VYIWHRISGKLLAVL-SGHSKTVNCVSWNPADPEMFASA 501 (519)
T ss_pred ceEEecCCCce-EEEEEccCCceeEee-cCCcceeeEEecCCCCHHHhhcc
Confidence 99999999 999999999999999 68998888888777 445443
No 138
>KOG0321 consensus WD40 repeat-containing protein L2DTL [Function unknown]
Probab=99.64 E-value=7.9e-15 Score=136.53 Aligned_cols=205 Identities=15% Similarity=0.190 Sum_probs=134.7
Q ss_pred ccCCCCCCeEEEEEcCCCC-EEEEEcCCc-EEEEEecCCc----e-----------------------eEEeeeecCCce
Q 020784 80 TSSSPPPTLLHISFNQDHG-CFAAGTDHG-FRIYNCDPFR----E-----------------------IFRRDFERGGGI 130 (321)
Q Consensus 80 ~~~~~~~~V~~v~fs~dg~-~lasg~~~g-v~vw~~~~~~----~-----------------------~~~~~~~~~~~v 130 (321)
...+|...|.+++|.++.. .|++|+.|| +.|||+.-.. . ...... +...+
T Consensus 139 ~~~GH~~SvkS~cf~~~n~~vF~tGgRDg~illWD~R~n~~d~~e~~~~~~~~~~n~~ptpskp~~kr~~k~kA-~s~ti 217 (720)
T KOG0321|consen 139 LNLGHTGSVKSECFMPTNPAVFCTGGRDGEILLWDCRCNGVDALEEFDNRIYGRHNTAPTPSKPLKKRIRKWKA-ASNTI 217 (720)
T ss_pred eecccccccchhhhccCCCcceeeccCCCcEEEEEEeccchhhHHHHhhhhhccccCCCCCCchhhcccccccc-ccCce
Confidence 3467889999999999764 678888877 7799973111 0 000000 22333
Q ss_pred EE---EEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEe------eCC------ceeEEEEeC--C-eEEEEE
Q 020784 131 GV---VEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELS------FRS------EVRSVKLRR--D-RIIVVL 192 (321)
Q Consensus 131 ~~---v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~------~~~------~v~~v~~~~--~-~~~~~~ 192 (321)
.. +-+..|...++.+++. |+.|||||+++.......+ ++. .+.++.... . .++.|+
T Consensus 218 ~ssvTvv~fkDe~tlaSaga~------D~~iKVWDLRk~~~~~r~ep~~~~~~~t~skrs~G~~nL~lDssGt~L~AsCt 291 (720)
T KOG0321|consen 218 FSSVTVVLFKDESTLASAGAA------DSTIKVWDLRKNYTAYRQEPRGSDKYPTHSKRSVGQVNLILDSSGTYLFASCT 291 (720)
T ss_pred eeeeEEEEEeccceeeeccCC------CcceEEEeecccccccccCCCcccCccCcccceeeeEEEEecCCCCeEEEEec
Confidence 32 3334567777777753 7999999998865543321 111 234444433 3 456678
Q ss_pred CCEEEEEEcCCc--EEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCc--ceEEeeccccceeEEEECC
Q 020784 193 EQKIFVYNFADL--KLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASK--RTKFIMAHDSRIACFALTQ 268 (321)
Q Consensus 193 ~~~I~iwd~~~~--~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~--~~~~l~~H~~~V~~vafsp 268 (321)
|+.|++||+... ..+..+.++........-...+|+++++ ||+.|+..+||.+..- ....+.+|...|++|+|.|
T Consensus 292 D~sIy~ynm~s~s~sP~~~~sg~~~~sf~vks~lSpd~~~l~-SgSsd~~ayiw~vs~~e~~~~~l~Ght~eVt~V~w~p 370 (720)
T KOG0321|consen 292 DNSIYFYNMRSLSISPVAEFSGKLNSSFYVKSELSPDDCSLL-SGSSDEQAYIWVVSSPEAPPALLLGHTREVTTVRWLP 370 (720)
T ss_pred CCcEEEEeccccCcCchhhccCcccceeeeeeecCCCCceEe-ccCCCcceeeeeecCccCChhhhhCcceEEEEEeecc
Confidence 999999999653 2333333332222222223345668888 7999999999988753 3568899999999999987
Q ss_pred C-CCEEEEEeCCCcEEEEEEcCCCcE
Q 020784 269 D-GQLLATSSTKGTLVRIFNTLDGTL 293 (321)
Q Consensus 269 d-g~~las~S~Dgt~IrIWd~~tg~~ 293 (321)
. -.-+||||+|-+ ++||++..|-+
T Consensus 371 S~~t~v~TcSdD~~-~kiW~l~~~l~ 395 (720)
T KOG0321|consen 371 SATTPVATCSDDFR-VKIWRLSNGLE 395 (720)
T ss_pred ccCCCceeeccCcc-eEEEeccCchh
Confidence 5 345788899999 99999977643
No 139
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=99.63 E-value=2.1e-13 Score=127.96 Aligned_cols=204 Identities=13% Similarity=0.187 Sum_probs=151.6
Q ss_pred CCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCcee-EEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 84 PPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREI-FRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~-~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
.+..|+|++|+.+.+.||.|-.+| |-||++...-.. ...+...+..|..++|+..+ .+..++ -+|.|.-|
T Consensus 24 ~Ps~I~slA~s~kS~~lAvsRt~g~IEiwN~~~~w~~~~vi~g~~drsIE~L~W~e~~-RLFS~g-------~sg~i~Ew 95 (691)
T KOG2048|consen 24 KPSEIVSLAYSHKSNQLAVSRTDGNIEIWNLSNNWFLEPVIHGPEDRSIESLAWAEGG-RLFSSG-------LSGSITEW 95 (691)
T ss_pred eccceEEEEEeccCCceeeeccCCcEEEEccCCCceeeEEEecCCCCceeeEEEccCC-eEEeec-------CCceEEEE
Confidence 446899999999999999998866 669998764321 11222135678899998444 444555 35999999
Q ss_pred eCCCCcEEEEEeeC-CceeEEEEeCC--eEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCC
Q 020784 162 DDHQSRCIGELSFR-SEVRSVKLRRD--RIIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQ 237 (321)
Q Consensus 162 D~~~~~~~~~~~~~-~~v~~v~~~~~--~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~ 237 (321)
|+.+++....++.. +.|.+++.++. .+.+++ ++.+.++++..+++........+...+.++++++++.-++ .|+.
T Consensus 96 Dl~~lk~~~~~d~~gg~IWsiai~p~~~~l~IgcddGvl~~~s~~p~~I~~~r~l~rq~sRvLslsw~~~~~~i~-~Gs~ 174 (691)
T KOG2048|consen 96 DLHTLKQKYNIDSNGGAIWSIAINPENTILAIGCDDGVLYDFSIGPDKITYKRSLMRQKSRVLSLSWNPTGTKIA-GGSI 174 (691)
T ss_pred ecccCceeEEecCCCcceeEEEeCCccceEEeecCCceEEEEecCCceEEEEeecccccceEEEEEecCCccEEE-eccc
Confidence 99999988877754 47999998864 455654 4677777888887766655555556788899999888777 4999
Q ss_pred CCcEEEEeeCCcc-eE----Eeec----cccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEe
Q 020784 238 KGQVRVEHYASKR-TK----FIMA----HDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEEC 298 (321)
Q Consensus 238 dg~V~i~d~~~~~-~~----~l~~----H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~ 298 (321)
||.|++||..... ++ .+.+ -..-|++|.|-.++ .+|+|..-|+ |++||...|.+++.++
T Consensus 175 Dg~Iriwd~~~~~t~~~~~~~~d~l~k~~~~iVWSv~~Lrd~-tI~sgDS~G~-V~FWd~~~gTLiqS~~ 242 (691)
T KOG2048|consen 175 DGVIRIWDVKSGQTLHIITMQLDRLSKREPTIVWSVLFLRDS-TIASGDSAGT-VTFWDSIFGTLIQSHS 242 (691)
T ss_pred CceEEEEEcCCCceEEEeeecccccccCCceEEEEEEEeecC-cEEEecCCce-EEEEcccCcchhhhhh
Confidence 9999999987654 33 1222 23348889888666 4788988999 9999999999988764
No 140
>KOG1408 consensus WD40 repeat protein [Function unknown]
Probab=99.63 E-value=1.7e-14 Score=135.89 Aligned_cols=221 Identities=14% Similarity=0.141 Sum_probs=150.2
Q ss_pred eEEEEEcCCCCEEEEEcCC-cEEEEEecCCcee---EEeeeecCCceEEEEEec----C-------CCeEEEEeCCCCCC
Q 020784 88 LLHISFNQDHGCFAAGTDH-GFRIYNCDPFREI---FRRDFERGGGIGVVEMLF----R-------CNILALVGGGPDPQ 152 (321)
Q Consensus 88 V~~v~fs~dg~~lasg~~~-gv~vw~~~~~~~~---~~~~~~~~~~v~~v~~~~----~-------~~~~~~~sg~~~~~ 152 (321)
--.+.|++..++|.+--++ .+.|||+...+.. +..-+ |...|-.|+..+ + ...+.+++
T Consensus 327 ~IA~~Fdet~~klscVYndhSlYvWDvrD~~kvgk~~s~ly-HS~ciW~Ve~~p~nv~~~~~aclp~~cF~TCS------ 399 (1080)
T KOG1408|consen 327 AIACQFDETTDKLSCVYNDHSLYVWDVRDVNKVGKCSSMLY-HSACIWDVENLPCNVHSPTAACLPRGCFTTCS------ 399 (1080)
T ss_pred eeEEEecCCCceEEEEEcCceEEEEeccccccccceeeeee-ccceeeeeccccccccCcccccCCccceeEec------
Confidence 4467899999999988774 5789998654332 22222 455555554433 1 12345555
Q ss_pred CCCCcEEEEeCCCC---cEEEE-----------------------------------EeeCCceeEEEEeCCeEEEEEC-
Q 020784 153 YPLNKVMIWDDHQS---RCIGE-----------------------------------LSFRSEVRSVKLRRDRIIVVLE- 193 (321)
Q Consensus 153 ~~d~~v~iWD~~~~---~~~~~-----------------------------------~~~~~~v~~v~~~~~~~~~~~~- 193 (321)
.|++||+||+..+ +..+. +.....+.+++++++.-.++.+
T Consensus 400 -sD~TIRlW~l~~ctnn~vyrRNils~~l~ki~y~d~~~q~~~d~~~~~fdka~~s~~d~r~G~R~~~vSp~gqhLAsGD 478 (1080)
T KOG1408|consen 400 -SDGTIRLWDLAFCTNNQVYRRNILSANLSKIPYEDSTQQIMHDASAGIFDKALVSTCDSRFGFRALAVSPDGQHLASGD 478 (1080)
T ss_pred -CCCcEEEeecccccccceeecccchhhhhcCccccCchhhhhhccCCcccccchhhcCcccceEEEEECCCcceecccC
Confidence 7899999998652 11110 0011247788888877655543
Q ss_pred --CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCC-CceEEEeecCCCCcEEEEeeCCc--ceEEeeccccceeEE----
Q 020784 194 --QKIFVYNFADLKLLHQIETIANPKGLCAVSQGV-GSLVLVCPGLQKGQVRVEHYASK--RTKFIMAHDSRIACF---- 264 (321)
Q Consensus 194 --~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~-d~~~la~sGs~dg~V~i~d~~~~--~~~~l~~H~~~V~~v---- 264 (321)
+.+|+|++...+...+++.|...+.+..++..- ...+|| |++.|.-|.|+|.... .+.++.+|.+.|++|
T Consensus 479 r~GnlrVy~Lq~l~~~~~~eAHesEilcLeyS~p~~~~kLLA-SasrdRlIHV~Dv~rny~l~qtld~HSssITsvKFa~ 557 (1080)
T KOG1408|consen 479 RGGNLRVYDLQELEYTCFMEAHESEILCLEYSFPVLTNKLLA-SASRDRLIHVYDVKRNYDLVQTLDGHSSSITSVKFAC 557 (1080)
T ss_pred ccCceEEEEehhhhhhhheecccceeEEEeecCchhhhHhhh-hccCCceEEEEecccccchhhhhcccccceeEEEEee
Confidence 699999999988888899999888888876543 245666 7999999999886432 233555555555444
Q ss_pred ---------------------------------------------EECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeC
Q 020784 265 ---------------------------------------------ALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECC 299 (321)
Q Consensus 265 ---------------------------------------------afspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~ 299 (321)
+..|+-+++++++.|+. |||||+++||..++|+.
T Consensus 558 ~gln~~MiscGADksimFr~~qk~~~g~~f~r~t~t~~ktTlYDm~Vdp~~k~v~t~cQDrn-irif~i~sgKq~k~FKg 636 (1080)
T KOG1408|consen 558 NGLNRKMISCGADKSIMFRVNQKASSGRLFPRHTQTLSKTTLYDMAVDPTSKLVVTVCQDRN-IRIFDIESGKQVKSFKG 636 (1080)
T ss_pred cCCceEEEeccCchhhheehhccccCceeccccccccccceEEEeeeCCCcceEEEEecccc-eEEEeccccceeeeecc
Confidence 44555556699999999 99999999999999974
Q ss_pred CCcc----eeEEEeecCceEEEe
Q 020784 300 PSIS----AQSGLWLSSAWLRVL 318 (321)
Q Consensus 300 g~~~----~~~~~s~d~~~la~~ 318 (321)
.++. ..+.+-++|.|||..
T Consensus 637 s~~~eG~lIKv~lDPSgiY~atS 659 (1080)
T KOG1408|consen 637 SRDHEGDLIKVILDPSGIYLATS 659 (1080)
T ss_pred cccCCCceEEEEECCCccEEEEe
Confidence 4332 344677888999874
No 141
>KOG4378 consensus Nuclear protein COP1 [Signal transduction mechanisms]
Probab=99.63 E-value=6e-15 Score=133.84 Aligned_cols=220 Identities=15% Similarity=0.092 Sum_probs=154.5
Q ss_pred CeEEEEEcCCCCEEEEEc---CCcEEEEEecC--CceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 87 TLLHISFNQDHGCFAAGT---DHGFRIYNCDP--FREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~---~~gv~vw~~~~--~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
.|.++.|+.... |++++ ++.+++|..+. .+.-..... .+..-.|+.+..- .+..++|| ..++|+||
T Consensus 36 g~~s~~w~~~n~-lvvas~~gdk~~~~~~K~g~~~~Vp~~~k~-~gd~~~Cv~~~s~--S~y~~sgG-----~~~~Vkiw 106 (673)
T KOG4378|consen 36 GDFSFNWQRRNF-LVVASMAGDKVMRIKEKDGKTPEVPRVRKL-TGDNAFCVACASQ--SLYEISGG-----QSGCVKIW 106 (673)
T ss_pred cceeeeccccce-EEEeecCCceeEEEecccCCCCccceeecc-ccchHHHHhhhhc--ceeeeccC-----cCceeeeh
Confidence 488899988765 44333 34467996532 222222222 1222223332222 24455555 45999999
Q ss_pred eCCCCcEEEEEeeC-CceeEEEEeCC--eEEEEEC-CEEEEEEcCCcEEEEEEeccCC-CCceEEEeeCCCceEEEeecC
Q 020784 162 DDHQSRCIGELSFR-SEVRSVKLRRD--RIIVVLE-QKIFVYNFADLKLLHQIETIAN-PKGLCAVSQGVGSLVLVCPGL 236 (321)
Q Consensus 162 D~~~~~~~~~~~~~-~~v~~v~~~~~--~~~~~~~-~~I~iwd~~~~~~~~~l~~~~~-~~~~~~~s~~~d~~~la~sGs 236 (321)
|++...+++.++.+ ..|++|.++.. .++.+.+ +.|.|-.+.++..-..|....+ .+..+.+++.. ..+..+.+
T Consensus 107 dl~~kl~hr~lkdh~stvt~v~YN~~DeyiAsvs~gGdiiih~~~t~~~tt~f~~~sgqsvRll~ys~sk--r~lL~~as 184 (673)
T KOG4378|consen 107 DLRAKLIHRFLKDHQSTVTYVDYNNTDEYIASVSDGGDIIIHGTKTKQKTTTFTIDSGQSVRLLRYSPSK--RFLLSIAS 184 (673)
T ss_pred hhHHHHHhhhccCCcceeEEEEecCCcceeEEeccCCcEEEEecccCccccceecCCCCeEEEeeccccc--ceeeEeec
Confidence 99977777776654 58999998754 4555554 6899999988777667765533 33456666654 44444689
Q ss_pred CCCcEEEEeeCCcc-e-EEeeccccceeEEEECCC-CCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCc
Q 020784 237 QKGQVRVEHYASKR-T-KFIMAHDSRIACFALTQD-GQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSA 313 (321)
Q Consensus 237 ~dg~V~i~d~~~~~-~-~~l~~H~~~V~~vafspd-g~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~ 313 (321)
.+|.|.+||.+... + ...+.|..+...|||+|. ..+|||.+.|+. |.+||+++.+...++...+.-..+.|+.+|.
T Consensus 185 d~G~VtlwDv~g~sp~~~~~~~HsAP~~gicfspsne~l~vsVG~Dkk-i~~yD~~s~~s~~~l~y~~Plstvaf~~~G~ 263 (673)
T KOG4378|consen 185 DKGAVTLWDVQGMSPIFHASEAHSAPCRGICFSPSNEALLVSVGYDKK-INIYDIRSQASTDRLTYSHPLSTVAFSECGT 263 (673)
T ss_pred cCCeEEEEeccCCCcccchhhhccCCcCcceecCCccceEEEecccce-EEEeecccccccceeeecCCcceeeecCCce
Confidence 99999999998754 3 367889999999999986 568999999999 9999999998888887777778889999999
Q ss_pred eEEEe
Q 020784 314 WLRVL 318 (321)
Q Consensus 314 ~la~~ 318 (321)
||++.
T Consensus 264 ~L~aG 268 (673)
T KOG4378|consen 264 YLCAG 268 (673)
T ss_pred EEEee
Confidence 99763
No 142
>KOG2106 consensus Uncharacterized conserved protein, contains HELP and WD40 domains [Function unknown]
Probab=99.63 E-value=2.1e-13 Score=124.09 Aligned_cols=215 Identities=18% Similarity=0.234 Sum_probs=155.0
Q ss_pred CCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC
Q 020784 86 PTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH 164 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~ 164 (321)
.-|.|++|.++|+. ++|..+| +.||+..+.+...... .|+++|.++++..++.++- |+ -|+.|..|| .
T Consensus 247 k~Vl~v~F~engdv-iTgDS~G~i~Iw~~~~~~~~k~~~-aH~ggv~~L~~lr~GtllS---Gg-----KDRki~~Wd-~ 315 (626)
T KOG2106|consen 247 KFVLCVTFLENGDV-ITGDSGGNILIWSKGTNRISKQVH-AHDGGVFSLCMLRDGTLLS---GG-----KDRKIILWD-D 315 (626)
T ss_pred eEEEEEEEcCCCCE-EeecCCceEEEEeCCCceEEeEee-ecCCceEEEEEecCccEee---cC-----ccceEEecc-c
Confidence 57999999999994 5666555 6699987776554444 4899999999998886553 44 479999999 4
Q ss_pred CCcEEEEEeeC---CceeEEEEeCCeEEEEEC-CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCc
Q 020784 165 QSRCIGELSFR---SEVRSVKLRRDRIIVVLE-QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQ 240 (321)
Q Consensus 165 ~~~~~~~~~~~---~~v~~v~~~~~~~~~~~~-~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~ 240 (321)
.-+.+++.+.+ +.|..+.-.+..+++++. +.|-.=+++++-.+ ...+|.. ....+..+++...++ +++.|+.
T Consensus 316 ~y~k~r~~elPe~~G~iRtv~e~~~di~vGTtrN~iL~Gt~~~~f~~-~v~gh~d--elwgla~hps~~q~~-T~gqdk~ 391 (626)
T KOG2106|consen 316 NYRKLRETELPEQFGPIRTVAEGKGDILVGTTRNFILQGTLENGFTL-TVQGHGD--ELWGLATHPSKNQLL-TCGQDKH 391 (626)
T ss_pred cccccccccCchhcCCeeEEecCCCcEEEeeccceEEEeeecCCceE-EEEeccc--ceeeEEcCCChhhee-eccCcce
Confidence 44444555543 467777766655777765 56666666554332 2334433 344444555556666 4889999
Q ss_pred EEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEee
Q 020784 241 VRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 241 V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~~ 319 (321)
|++|+ ..++.--+.-..++.|+.|+|.| .+|.|...|. .-|.|.++..++..-..+.....+.+++||.+||+++
T Consensus 392 v~lW~--~~k~~wt~~~~d~~~~~~fhpsg-~va~Gt~~G~-w~V~d~e~~~lv~~~~d~~~ls~v~ysp~G~~lAvgs 466 (626)
T KOG2106|consen 392 VRLWN--DHKLEWTKIIEDPAECADFHPSG-VVAVGTATGR-WFVLDTETQDLVTIHTDNEQLSVVRYSPDGAFLAVGS 466 (626)
T ss_pred EEEcc--CCceeEEEEecCceeEeeccCcc-eEEEeeccce-EEEEecccceeEEEEecCCceEEEEEcCCCCEEEEec
Confidence 99999 44444444567889999999999 8999999999 7799999987776655555556679999999999975
No 143
>KOG0771 consensus Prolactin regulatory element-binding protein/Protein transport protein SEC12p [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.61 E-value=1.9e-14 Score=128.40 Aligned_cols=189 Identities=16% Similarity=0.198 Sum_probs=134.0
Q ss_pred EEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCc
Q 020784 89 LHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSR 167 (321)
Q Consensus 89 ~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~ 167 (321)
.+++|+.||..|++|+.|| +|||++.....+..... |.+.|..+.+++++..++.++ .| ..+|||++++.
T Consensus 148 k~vaf~~~gs~latgg~dg~lRv~~~Ps~~t~l~e~~-~~~eV~DL~FS~dgk~lasig-------~d-~~~VW~~~~g~ 218 (398)
T KOG0771|consen 148 KVVAFNGDGSKLATGGTDGTLRVWEWPSMLTILEEIA-HHAEVKDLDFSPDGKFLASIG-------AD-SARVWSVNTGA 218 (398)
T ss_pred eEEEEcCCCCEeeeccccceEEEEecCcchhhhhhHh-hcCccccceeCCCCcEEEEec-------CC-ceEEEEeccCc
Confidence 7899999999999999877 78999876654433222 678999999999999999998 45 79999999997
Q ss_pred EEEEEe-eCC--ceeEEEEeCCe----EEEE-E---CCEEEEEEcCCcE---EEE--EEeccCCCCceEEEeeCCCceEE
Q 020784 168 CIGELS-FRS--EVRSVKLRRDR----IIVV-L---EQKIFVYNFADLK---LLH--QIETIANPKGLCAVSQGVGSLVL 231 (321)
Q Consensus 168 ~~~~~~-~~~--~v~~v~~~~~~----~~~~-~---~~~I~iwd~~~~~---~~~--~l~~~~~~~~~~~~s~~~d~~~l 231 (321)
.+.... +.. ....+.|..+. +.++ . .+.|+.|++...+ .++ +.......+.+++++ .||.++
T Consensus 219 ~~a~~t~~~k~~~~~~cRF~~d~~~~~l~laa~~~~~~~v~~~~~~~w~~~~~l~~~~~~~~~~siSsl~VS--~dGkf~ 296 (398)
T KOG0771|consen 219 ALARKTPFSKDEMFSSCRFSVDNAQETLRLAASQFPGGGVRLCDISLWSGSNFLRLRKKIKRFKSISSLAVS--DDGKFL 296 (398)
T ss_pred hhhhcCCcccchhhhhceecccCCCceEEEEEecCCCCceeEEEeeeeccccccchhhhhhccCcceeEEEc--CCCcEE
Confidence 776654 222 23344554432 2222 2 2467776663211 111 111112234445555 466999
Q ss_pred EeecCCCCcEEEEeeCCcc-e-EEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 232 VCPGLQKGQVRVEHYASKR-T-KFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 232 a~sGs~dg~V~i~d~~~~~-~-~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
|. |+.||.|.|++...-+ + ..-++|..-|+.|.|+||.+++++.|.|.+ ++|..+.-
T Consensus 297 Al-GT~dGsVai~~~~~lq~~~~vk~aH~~~VT~ltF~Pdsr~~~svSs~~~-~~v~~l~v 355 (398)
T KOG0771|consen 297 AL-GTMDGSVAIYDAKSLQRLQYVKEAHLGFVTGLTFSPDSRYLASVSSDNE-AAVTKLAV 355 (398)
T ss_pred EE-eccCCcEEEEEeceeeeeEeehhhheeeeeeEEEcCCcCcccccccCCc-eeEEEEee
Confidence 96 9999999998876544 2 355689999999999999999999999999 99987653
No 144
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.61 E-value=1.8e-14 Score=120.37 Aligned_cols=203 Identities=14% Similarity=0.128 Sum_probs=147.9
Q ss_pred ccCCCCCCeEEEEEcC--CCCEEEEEcCCc-EEEEEecCCceeEEeeee-cCCceEEEEEecCCCeEEEEeCCCCCCCCC
Q 020784 80 TSSSPPPTLLHISFNQ--DHGCFAAGTDHG-FRIYNCDPFREIFRRDFE-RGGGIGVVEMLFRCNILALVGGGPDPQYPL 155 (321)
Q Consensus 80 ~~~~~~~~V~~v~fs~--dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~-~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d 155 (321)
...+|.++|.-++|-- -|.+||+++-++ |.||.-+.++.....++. |...+..+++.++.-.+.+++++ +|
T Consensus 51 ~L~Gh~GPVwqv~wahPk~G~iLAScsYDgkVIiWke~~g~w~k~~e~~~h~~SVNsV~wapheygl~Lacas-----SD 125 (299)
T KOG1332|consen 51 ELTGHSGPVWKVAWAHPKFGTILASCSYDGKVIIWKEENGRWTKAYEHAAHSASVNSVAWAPHEYGLLLACAS-----SD 125 (299)
T ss_pred EecCCCCCeeEEeecccccCcEeeEeecCceEEEEecCCCchhhhhhhhhhcccceeecccccccceEEEEee-----CC
Confidence 3478999999999976 799999999866 889998777533222222 78899999998876555554433 78
Q ss_pred CcEEEEeCCCC-cE-EEEE--eeCCceeEEEEeCC----------------eEEEE-ECCEEEEEEcCCc--EEEEEEec
Q 020784 156 NKVMIWDDHQS-RC-IGEL--SFRSEVRSVKLRRD----------------RIIVV-LEQKIFVYNFADL--KLLHQIET 212 (321)
Q Consensus 156 ~~v~iWD~~~~-~~-~~~~--~~~~~v~~v~~~~~----------------~~~~~-~~~~I~iwd~~~~--~~~~~l~~ 212 (321)
|+|.|.+.+.. .. ...+ -+..-|.+++|.+- +++.+ .|+.|+||+..++ ++-++|..
T Consensus 126 G~vsvl~~~~~g~w~t~ki~~aH~~GvnsVswapa~~~g~~~~~~~~~~~krlvSgGcDn~VkiW~~~~~~w~~e~~l~~ 205 (299)
T KOG1332|consen 126 GKVSVLTYDSSGGWTTSKIVFAHEIGVNSVSWAPASAPGSLVDQGPAAKVKRLVSGGCDNLVKIWKFDSDSWKLERTLEG 205 (299)
T ss_pred CcEEEEEEcCCCCccchhhhhccccccceeeecCcCCCccccccCcccccceeeccCCccceeeeecCCcchhhhhhhhh
Confidence 99999998754 22 1112 23346788888653 34444 3579999999763 44456888
Q ss_pred cCCCCceEEEeeCCC--ceEEEeecCCCCcEEEEeeCCc----ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEE
Q 020784 213 IANPKGLCAVSQGVG--SLVLVCPGLQKGQVRVEHYASK----RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIF 286 (321)
Q Consensus 213 ~~~~~~~~~~s~~~d--~~~la~sGs~dg~V~i~d~~~~----~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIW 286 (321)
|...+.-++.+|.-. ...|| |++.||+|.||..... +.+.++.....+..+.||..|..||.++.|+. |.+|
T Consensus 206 H~dwVRDVAwaP~~gl~~s~iA-S~SqDg~viIwt~~~e~e~wk~tll~~f~~~~w~vSWS~sGn~LaVs~GdNk-vtlw 283 (299)
T KOG1332|consen 206 HKDWVRDVAWAPSVGLPKSTIA-SCSQDGTVIIWTKDEEYEPWKKTLLEEFPDVVWRVSWSLSGNILAVSGGDNK-VTLW 283 (299)
T ss_pred cchhhhhhhhccccCCCceeeE-EecCCCcEEEEEecCccCcccccccccCCcceEEEEEeccccEEEEecCCcE-EEEE
Confidence 888887777777532 34667 7999999999976532 23356667889999999999999999999999 9999
Q ss_pred EcC
Q 020784 287 NTL 289 (321)
Q Consensus 287 d~~ 289 (321)
.=.
T Consensus 284 ke~ 286 (299)
T KOG1332|consen 284 KEN 286 (299)
T ss_pred EeC
Confidence 643
No 145
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=99.61 E-value=5e-14 Score=128.42 Aligned_cols=218 Identities=10% Similarity=0.080 Sum_probs=144.3
Q ss_pred CCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEee-------ee----cCCceEEEEEecCCC-eEEEEeCCCCC
Q 020784 85 PPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRD-------FE----RGGGIGVVEMLFRCN-ILALVGGGPDP 151 (321)
Q Consensus 85 ~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~-------~~----~~~~v~~v~~~~~~~-~~~~~sg~~~~ 151 (321)
...|++++|++.|..|++.+. -..+|+|-+-....-... +. |...+.+.+|++... .+.+++
T Consensus 214 ~h~i~sl~ys~Tg~~iLvvsg~aqakl~DRdG~~~~e~~KGDQYI~Dm~nTKGHia~lt~g~whP~~k~~FlT~s----- 288 (641)
T KOG0772|consen 214 THQINSLQYSVTGDQILVVSGSAQAKLLDRDGFEIVEFSKGDQYIRDMYNTKGHIAELTCGCWHPDNKEEFLTCS----- 288 (641)
T ss_pred ccccceeeecCCCCeEEEEecCcceeEEccCCceeeeeeccchhhhhhhccCCceeeeeccccccCcccceEEec-----
Confidence 358999999999987665554 557788865443321111 10 334556668877654 445555
Q ss_pred CCCCCcEEEEeCCCCcE-EEEEee------CCceeEEEEeCCeEEE---EECCEEEEEEcCCcEE--EE-EEeccCCCCc
Q 020784 152 QYPLNKVMIWDDHQSRC-IGELSF------RSEVRSVKLRRDRIIV---VLEQKIFVYNFADLKL--LH-QIETIANPKG 218 (321)
Q Consensus 152 ~~~d~~v~iWD~~~~~~-~~~~~~------~~~v~~v~~~~~~~~~---~~~~~I~iwd~~~~~~--~~-~l~~~~~~~~ 218 (321)
.|+++||||+++.+. ..-++. ...++.+.|+++...+ |.++.|.+|+...... .. .-+.|.....
T Consensus 289 --~DgtlRiWdv~~~k~q~qVik~k~~~g~Rv~~tsC~~nrdg~~iAagc~DGSIQ~W~~~~~~v~p~~~vk~AH~~g~~ 366 (641)
T KOG0772|consen 289 --YDGTLRIWDVNNTKSQLQVIKTKPAGGKRVPVTSCAWNRDGKLIAAGCLDGSIQIWDKGSRTVRPVMKVKDAHLPGQD 366 (641)
T ss_pred --CCCcEEEEecCCchhheeEEeeccCCCcccCceeeecCCCcchhhhcccCCceeeeecCCcccccceEeeeccCCCCc
Confidence 689999999986542 222332 1268889999876433 3568999999854322 12 2245655445
Q ss_pred eEEEeeCCCceEEEeecCCCCcEEEEeeCC--cceEEeeccc--cceeEEEECCCCCEEEEEeC------CCcEEEEEEc
Q 020784 219 LCAVSQGVGSLVLVCPGLQKGQVRVEHYAS--KRTKFIMAHD--SRIACFALTQDGQLLATSST------KGTLVRIFNT 288 (321)
Q Consensus 219 ~~~~s~~~d~~~la~sGs~dg~V~i~d~~~--~~~~~l~~H~--~~V~~vafspdg~~las~S~------Dgt~IrIWd~ 288 (321)
+.++++..|+++|+ |-+.|+++++||+.. +++++..+-- -+-+.++|||+.++++||.. .|+ +.+||.
T Consensus 367 Itsi~FS~dg~~Ll-SRg~D~tLKvWDLrq~kkpL~~~tgL~t~~~~tdc~FSPd~kli~TGtS~~~~~~~g~-L~f~d~ 444 (641)
T KOG0772|consen 367 ITSISFSYDGNYLL-SRGFDDTLKVWDLRQFKKPLNVRTGLPTPFPGTDCCFSPDDKLILTGTSAPNGMTAGT-LFFFDR 444 (641)
T ss_pred eeEEEeccccchhh-hccCCCceeeeeccccccchhhhcCCCccCCCCccccCCCceEEEecccccCCCCCce-EEEEec
Confidence 55556666779998 688999999999875 3455554432 34678999999999999743 567 889999
Q ss_pred CCCcEEEEEeCCCcceeEEEeecC
Q 020784 289 LDGTLLQEECCPSISAQSGLWLSS 312 (321)
Q Consensus 289 ~tg~~i~~~~~g~~~~~~~~s~d~ 312 (321)
.+.+.++++... ...++...|.+
T Consensus 445 ~t~d~v~ki~i~-~aSvv~~~Whp 467 (641)
T KOG0772|consen 445 MTLDTVYKIDIS-TASVVRCLWHP 467 (641)
T ss_pred cceeeEEEecCC-CceEEEEeecc
Confidence 999998887543 34444555555
No 146
>KOG2106 consensus Uncharacterized conserved protein, contains HELP and WD40 domains [Function unknown]
Probab=99.60 E-value=5.7e-13 Score=121.36 Aligned_cols=197 Identities=16% Similarity=0.231 Sum_probs=146.4
Q ss_pred ccCCCCCCeEEEEEcCCCCEEEEEcCC---------cEEEEEecCCceeEEeeeecCCceEEEEEec--CCCeEEEEeCC
Q 020784 80 TSSSPPPTLLHISFNQDHGCFAAGTDH---------GFRIYNCDPFREIFRRDFERGGGIGVVEMLF--RCNILALVGGG 148 (321)
Q Consensus 80 ~~~~~~~~V~~v~fs~dg~~lasg~~~---------gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~--~~~~~~~~sg~ 148 (321)
....|+..|.|+..+||.-++|+|-.. .|||||..+...++...+ -+..|.+++++. .+++++.+..+
T Consensus 99 ~y~GH~ddikc~~vHPdri~vatGQ~ag~~g~~~~phvriWdsv~L~TL~V~g~-f~~GV~~vaFsk~~~G~~l~~vD~s 177 (626)
T KOG2106|consen 99 HYLGHNDDIKCMAVHPDRIRVATGQGAGTSGRPLQPHVRIWDSVTLSTLHVIGF-FDRGVTCVAFSKINGGSLLCAVDDS 177 (626)
T ss_pred cccCCCCceEEEeecCCceeeccCcccccCCCcCCCeeeecccccceeeeeecc-ccccceeeeecccCCCceEEEecCC
Confidence 346788999999999999988876532 289999777766655543 256788888865 45666666644
Q ss_pred CCCCCCCCcEEEEeCCCCcEEEEEeeCC-ceeEEEEeCC---eEEEEECCEEEEEEcCCcEEEEEEec---cCCCCceEE
Q 020784 149 PDPQYPLNKVMIWDDHQSRCIGELSFRS-EVRSVKLRRD---RIIVVLEQKIFVYNFADLKLLHQIET---IANPKGLCA 221 (321)
Q Consensus 149 ~~~~~~d~~v~iWD~~~~~~~~~~~~~~-~v~~v~~~~~---~~~~~~~~~I~iwd~~~~~~~~~l~~---~~~~~~~~~ 221 (321)
++..+-|||.+.+......+... .|....|||. .++.+..+.+.+|+.+.+.+.++... +.. ..+.+
T Consensus 178 -----~~h~lSVWdWqk~~~~~~vk~sne~v~~a~FHPtd~nliit~Gk~H~~Fw~~~~~~l~k~~~~fek~ek-k~Vl~ 251 (626)
T KOG2106|consen 178 -----NPHMLSVWDWQKKAKLGPVKTSNEVVFLATFHPTDPNLIITCGKGHLYFWTLRGGSLVKRQGIFEKREK-KFVLC 251 (626)
T ss_pred -----CccccchhhchhhhccCcceeccceEEEEEeccCCCcEEEEeCCceEEEEEccCCceEEEeeccccccc-eEEEE
Confidence 57889999999888776666544 5677889974 34445567999999998877766533 322 44566
Q ss_pred EeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEE
Q 020784 222 VSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 222 ~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd 287 (321)
+.+.+++..+ +|+.+|.|.||+..+.. .++..+|.+.|.+++.-.+|.+|- |+.|+. |-.||
T Consensus 252 v~F~engdvi--TgDS~G~i~Iw~~~~~~~~k~~~aH~ggv~~L~~lr~GtllS-GgKDRk-i~~Wd 314 (626)
T KOG2106|consen 252 VTFLENGDVI--TGDSGGNILIWSKGTNRISKQVHAHDGGVFSLCMLRDGTLLS-GGKDRK-IILWD 314 (626)
T ss_pred EEEcCCCCEE--eecCCceEEEEeCCCceEEeEeeecCCceEEEEEecCccEee-cCccce-EEecc
Confidence 6666666666 49999999999976544 334449999999999999998664 888988 88998
No 147
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=99.59 E-value=1.3e-13 Score=124.16 Aligned_cols=228 Identities=12% Similarity=0.097 Sum_probs=153.2
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecC--CceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCc
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDP--FREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNK 157 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~--~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~ 157 (321)
.+...+.|+||.|+|.-..|.+++- +.++||.++- ...+....+ ...+|...++.+++...+++++. .+-
T Consensus 209 ~~ps~~~I~sv~FHp~~plllvaG~d~~lrifqvDGk~N~~lqS~~l-~~fPi~~a~f~p~G~~~i~~s~r------rky 281 (514)
T KOG2055|consen 209 AHPSHGGITSVQFHPTAPLLLVAGLDGTLRIFQVDGKVNPKLQSIHL-EKFPIQKAEFAPNGHSVIFTSGR------RKY 281 (514)
T ss_pred CCcCcCCceEEEecCCCceEEEecCCCcEEEEEecCccChhheeeee-ccCccceeeecCCCceEEEeccc------ceE
Confidence 3444568999999999998887776 5589998853 334444444 36789999999988866666643 366
Q ss_pred EEEEeCCCCcEEEEEe--e--CCceeEEEEeCC--eEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceE
Q 020784 158 VMIWDDHQSRCIGELS--F--RSEVRSVKLRRD--RIIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLV 230 (321)
Q Consensus 158 v~iWD~~~~~~~~~~~--~--~~~v~~v~~~~~--~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~ 230 (321)
+.+||+.+.+....-. . ...+....++++ .+++++ .+.|.+.-..+++.+.+++.... +.-.+|+ .|+..
T Consensus 282 ~ysyDle~ak~~k~~~~~g~e~~~~e~FeVShd~~fia~~G~~G~I~lLhakT~eli~s~KieG~-v~~~~fs--Sdsk~ 358 (514)
T KOG2055|consen 282 LYSYDLETAKVTKLKPPYGVEEKSMERFEVSHDSNFIAIAGNNGHIHLLHAKTKELITSFKIEGV-VSDFTFS--SDSKE 358 (514)
T ss_pred EEEeeccccccccccCCCCcccchhheeEecCCCCeEEEcccCceEEeehhhhhhhhheeeeccE-EeeEEEe--cCCcE
Confidence 8999998876543211 1 113444455544 344443 36999999999999888875422 2334444 44455
Q ss_pred EEeecCCCCcEEEEeeCCcc-eEEeecccc-ceeEEEECCCCCEEEEEeCCCcEEEEEEcCC------CcEEEEEeCCCc
Q 020784 231 LVCPGLQKGQVRVEHYASKR-TKFIMAHDS-RIACFALTQDGQLLATSSTKGTLVRIFNTLD------GTLLQEECCPSI 302 (321)
Q Consensus 231 la~sGs~dg~V~i~d~~~~~-~~~l~~H~~-~V~~vafspdg~~las~S~Dgt~IrIWd~~t------g~~i~~~~~g~~ 302 (321)
|.+ .+.+|.|.+||++... ++.+....+ .=+++|.|++|.|||+||.-|- |.|+|..+ -+.+.++..-..
T Consensus 359 l~~-~~~~GeV~v~nl~~~~~~~rf~D~G~v~gts~~~S~ng~ylA~GS~~Gi-VNIYd~~s~~~s~~PkPik~~dNLtt 436 (514)
T KOG2055|consen 359 LLA-SGGTGEVYVWNLRQNSCLHRFVDDGSVHGTSLCISLNGSYLATGSDSGI-VNIYDGNSCFASTNPKPIKTVDNLTT 436 (514)
T ss_pred EEE-EcCCceEEEEecCCcceEEEEeecCccceeeeeecCCCceEEeccCcce-EEEeccchhhccCCCCchhhhhhhhe
Confidence 543 4557899999998764 444443221 2367888999999999998888 99999765 245555532222
Q ss_pred -ceeEEEeecCceEEEeec
Q 020784 303 -SAQSGLWLSSAWLRVLRT 320 (321)
Q Consensus 303 -~~~~~~s~d~~~la~~~~ 320 (321)
...++|++|++.||+|+.
T Consensus 437 ~Itsl~Fn~d~qiLAiaS~ 455 (514)
T KOG2055|consen 437 AITSLQFNHDAQILAIASR 455 (514)
T ss_pred eeeeeeeCcchhhhhhhhh
Confidence 334588999999999864
No 148
>KOG4378 consensus Nuclear protein COP1 [Signal transduction mechanisms]
Probab=99.59 E-value=3.6e-14 Score=128.85 Aligned_cols=214 Identities=10% Similarity=0.117 Sum_probs=154.9
Q ss_pred CeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCC
Q 020784 87 TLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQ 165 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~ 165 (321)
.-.|++......|+++|+..+ |+|||+....+..... .|...|.+|.......++|.++.+ |.|.|-.+.+
T Consensus 81 ~~~Cv~~~s~S~y~~sgG~~~~Vkiwdl~~kl~hr~lk-dh~stvt~v~YN~~DeyiAsvs~g-------Gdiiih~~~t 152 (673)
T KOG4378|consen 81 NAFCVACASQSLYEISGGQSGCVKIWDLRAKLIHRFLK-DHQSTVTYVDYNNTDEYIASVSDG-------GDIIIHGTKT 152 (673)
T ss_pred hHHHHhhhhcceeeeccCcCceeeehhhHHHHHhhhcc-CCcceeEEEEecCCcceeEEeccC-------CcEEEEeccc
Confidence 345555555568999998855 7799998433322222 267788888888888899988844 8899999999
Q ss_pred CcEEEEEeeCC--ceeEEEEeCC---eEEEEEC-CEEEEEEcCCcEEEEEE-eccCCCCceEEEeeCCCceEEEeecCCC
Q 020784 166 SRCIGELSFRS--EVRSVKLRRD---RIIVVLE-QKIFVYNFADLKLLHQI-ETIANPKGLCAVSQGVGSLVLVCPGLQK 238 (321)
Q Consensus 166 ~~~~~~~~~~~--~v~~v~~~~~---~~~~~~~-~~I~iwd~~~~~~~~~l-~~~~~~~~~~~~s~~~d~~~la~sGs~d 238 (321)
+....+|.... .|.-+.+++. .+.++++ +.|.+||+..+..+..+ +.|..|..-+||++.. ..|.++-+.|
T Consensus 153 ~~~tt~f~~~sgqsvRll~ys~skr~lL~~asd~G~VtlwDv~g~sp~~~~~~~HsAP~~gicfspsn--e~l~vsVG~D 230 (673)
T KOG4378|consen 153 KQKTTTFTIDSGQSVRLLRYSPSKRFLLSIASDKGAVTLWDVQGMSPIFHASEAHSAPCRGICFSPSN--EALLVSVGYD 230 (673)
T ss_pred CccccceecCCCCeEEEeecccccceeeEeeccCCeEEEEeccCCCcccchhhhccCCcCcceecCCc--cceEEEeccc
Confidence 98888887763 5656777753 2444554 69999999887776655 4577777777777754 3343467889
Q ss_pred CcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeec
Q 020784 239 GQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLS 311 (321)
Q Consensus 239 g~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d 311 (321)
..|.+||...+....--....+..+|+|+++|.+|+.|+..|. |.-||++.-+.--+....|+....+++|.
T Consensus 231 kki~~yD~~s~~s~~~l~y~~Plstvaf~~~G~~L~aG~s~G~-~i~YD~R~~k~Pv~v~sah~~sVt~vafq 302 (673)
T KOG4378|consen 231 KKINIYDIRSQASTDRLTYSHPLSTVAFSECGTYLCAGNSKGE-LIAYDMRSTKAPVAVRSAHDASVTRVAFQ 302 (673)
T ss_pred ceEEEeecccccccceeeecCCcceeeecCCceEEEeecCCce-EEEEecccCCCCceEeeecccceeEEEee
Confidence 9999999886654433345678999999999999999999999 88999997664333445666665555443
No 149
>KOG0290 consensus Conserved WD40 repeat-containing protein AN11 [Function unknown]
Probab=99.58 E-value=1.7e-13 Score=117.16 Aligned_cols=229 Identities=10% Similarity=0.087 Sum_probs=152.4
Q ss_pred CCCCCCeEEEEEcCCCC-----EEEEEcCCcEEEEEecCCceeEEee--ee------cCCceEEEEEec-CCCeEEEEeC
Q 020784 82 SSPPPTLLHISFNQDHG-----CFAAGTDHGFRIYNCDPFREIFRRD--FE------RGGGIGVVEMLF-RCNILALVGG 147 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~-----~lasg~~~gv~vw~~~~~~~~~~~~--~~------~~~~v~~v~~~~-~~~~~~~~sg 147 (321)
..|+.+++-+.|.||.. +||+. .+-+|||.+.........+ +. +..++....|.- +.+++.+.+
T Consensus 93 fd~~YP~tK~~wiPd~~g~~pdlLATs-~D~LRlWri~~ee~~~~~~~~L~~~kns~~~aPlTSFDWne~dp~~igtSS- 170 (364)
T KOG0290|consen 93 FDHPYPVTKLMWIPDSKGVYPDLLATS-SDFLRLWRIGDEESRVELQSVLNNNKNSEFCAPLTSFDWNEVDPNLIGTSS- 170 (364)
T ss_pred CCCCCCccceEecCCccccCcchhhcc-cCeEEEEeccCcCCceehhhhhccCcccccCCcccccccccCCcceeEeec-
Confidence 46778999999999863 45554 5677999886422111110 00 234555555533 566776666
Q ss_pred CCCCCCCCCcEEEEeCCCCcE----EEEEeeCCceeEEEEeCC---eEEEE-ECCEEEEEEcCCcEEEEEEeccCC-CCc
Q 020784 148 GPDPQYPLNKVMIWDDHQSRC----IGELSFRSEVRSVKLRRD---RIIVV-LEQKIFVYNFADLKLLHQIETIAN-PKG 218 (321)
Q Consensus 148 ~~~~~~~d~~v~iWD~~~~~~----~~~~~~~~~v~~v~~~~~---~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~-~~~ 218 (321)
-|-+..|||++++.. .+-+.++++|+.++|... .++.+ .||.+|+||++..+--..+-...+ ...
T Consensus 171 ------iDTTCTiWdie~~~~~~vkTQLIAHDKEV~DIaf~~~s~~~FASvgaDGSvRmFDLR~leHSTIIYE~p~~~~p 244 (364)
T KOG0290|consen 171 ------IDTTCTIWDIETGVSGTVKTQLIAHDKEVYDIAFLKGSRDVFASVGADGSVRMFDLRSLEHSTIIYEDPSPSTP 244 (364)
T ss_pred ------ccCeEEEEEEeeccccceeeEEEecCcceeEEEeccCccceEEEecCCCcEEEEEecccccceEEecCCCCCCc
Confidence 689999999998732 234667889999999873 34544 468999999987654333332222 233
Q ss_pred eEEEeeCC-CceEEEeecCCCCcEEEEeeCC--cceEEeeccccceeEEEECCC-CCEEEEEeCCCcEEEEEEcCCCc--
Q 020784 219 LCAVSQGV-GSLVLVCPGLQKGQVRVEHYAS--KRTKFIMAHDSRIACFALTQD-GQLLATSSTKGTLVRIFNTLDGT-- 292 (321)
Q Consensus 219 ~~~~s~~~-d~~~la~sGs~dg~V~i~d~~~--~~~~~l~~H~~~V~~vafspd-g~~las~S~Dgt~IrIWd~~tg~-- 292 (321)
...++++. |-+++|.-+-....|.|.|++. .++..|++|.+.|+.|+|.|. ...++||++|.. +-|||+.+.-
T Consensus 245 LlRLswnkqDpnymATf~~dS~~V~iLDiR~P~tpva~L~~H~a~VNgIaWaPhS~~hictaGDD~q-aliWDl~q~~~~ 323 (364)
T KOG0290|consen 245 LLRLSWNKQDPNYMATFAMDSNKVVILDIRVPCTPVARLRNHQASVNGIAWAPHSSSHICTAGDDCQ-ALIWDLQQMPRE 323 (364)
T ss_pred ceeeccCcCCchHHhhhhcCCceEEEEEecCCCcceehhhcCcccccceEecCCCCceeeecCCcce-EEEEeccccccc
Confidence 45555543 3356664344455788877765 457789999999999999986 678999997776 9999998632
Q ss_pred ----EEEEEeCCCcceeEEEe-ecCceEEEee
Q 020784 293 ----LLQEECCPSISAQSGLW-LSSAWLRVLR 319 (321)
Q Consensus 293 ----~i~~~~~g~~~~~~~~s-~d~~~la~~~ 319 (321)
.+-.|..+++...++.+ ..+.|+|+|.
T Consensus 324 ~~~dPilay~a~~EVNqi~Ws~~~~Dwiai~~ 355 (364)
T KOG0290|consen 324 NGEDPILAYTAGGEVNQIQWSSSQPDWIAICF 355 (364)
T ss_pred CCCCchhhhhccceeeeeeecccCCCEEEEEe
Confidence 23345556665566554 5568999864
No 150
>KOG1007 consensus WD repeat protein TSSC1, WD repeat superfamily [Function unknown]
Probab=99.58 E-value=5e-14 Score=120.33 Aligned_cols=198 Identities=14% Similarity=0.132 Sum_probs=141.3
Q ss_pred CCCCCCeEEEEEcCC-CCEEEEEcC--------CcEEEEEecCC---------ceeEEeeeecCCceEEEEEecCCCeEE
Q 020784 82 SSPPPTLLHISFNQD-HGCFAAGTD--------HGFRIYNCDPF---------REIFRRDFERGGGIGVVEMLFRCNILA 143 (321)
Q Consensus 82 ~~~~~~V~~v~fs~d-g~~lasg~~--------~gv~vw~~~~~---------~~~~~~~~~~~~~v~~v~~~~~~~~~~ 143 (321)
..|.+.|..++-+|- .+.|++... -+..||.+... +.+......+-+.+.+++|.|++..++
T Consensus 60 ~h~agEvw~las~P~d~~ilaT~yn~~s~s~vl~~aaiw~ipe~~~~S~~~tlE~v~~Ldteavg~i~cvew~Pns~kla 139 (370)
T KOG1007|consen 60 FHHAGEVWDLASSPFDQRILATVYNDTSDSGVLTGAAIWQIPEPLGQSNSSTLECVASLDTEAVGKINCVEWEPNSDKLA 139 (370)
T ss_pred hcCCcceehhhcCCCCCceEEEEEeccCCCcceeeEEEEecccccCccccchhhHhhcCCHHHhCceeeEEEcCCCCeeE
Confidence 456679999999984 556776543 13569987432 122222211346889999999998888
Q ss_pred EEeCCCCCCCCCCcEEEEeCCCCcE-EEEEee------CCceeEEEEeC----CeEEEEECCEEEEEEcCCcEEEEEEec
Q 020784 144 LVGGGPDPQYPLNKVMIWDDHQSRC-IGELSF------RSEVRSVKLRR----DRIIVVLEQKIFVYNFADLKLLHQIET 212 (321)
Q Consensus 144 ~~sg~~~~~~~d~~v~iWD~~~~~~-~~~~~~------~~~v~~v~~~~----~~~~~~~~~~I~iwd~~~~~~~~~l~~ 212 (321)
... |+.|.+|+++.+.. +.++.. ....++-.|++ +.++...++++..||+++++....+..
T Consensus 140 sm~--------dn~i~l~~l~ess~~vaev~ss~s~e~~~~ftsg~WspHHdgnqv~tt~d~tl~~~D~RT~~~~~sI~d 211 (370)
T KOG1007|consen 140 SMD--------DNNIVLWSLDESSKIVAEVLSSESAEMRHSFTSGAWSPHHDGNQVATTSDSTLQFWDLRTMKKNNSIED 211 (370)
T ss_pred Eec--------cCceEEEEcccCcchheeecccccccccceecccccCCCCccceEEEeCCCcEEEEEccchhhhcchhh
Confidence 775 68999999988765 444332 22455666765 346666778999999999888777754
Q ss_pred -cCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCC--cceEEeeccccceeEEEECCC-CCEEEEEeCCCcEEEEEEc
Q 020784 213 -IANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYAS--KRTKFIMAHDSRIACFALTQD-GQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 213 -~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~--~~~~~l~~H~~~V~~vafspd-g~~las~S~Dgt~IrIWd~ 288 (321)
|.+-+.-+.| +|+.+.+.++|+.||.|+|||.+. .++.++.+|...|.+|.|+|. .+++.|||.|.. |.+|..
T Consensus 212 AHgq~vrdlDf--Npnkq~~lvt~gDdgyvriWD~R~tk~pv~el~~HsHWvW~VRfn~~hdqLiLs~~SDs~-V~Lsca 288 (370)
T KOG1007|consen 212 AHGQRVRDLDF--NPNKQHILVTCGDDGYVRIWDTRKTKFPVQELPGHSHWVWAVRFNPEHDQLILSGGSDSA-VNLSCA 288 (370)
T ss_pred hhcceeeeccC--CCCceEEEEEcCCCccEEEEeccCCCccccccCCCceEEEEEEecCccceEEEecCCCce-eEEEec
Confidence 4443334444 455555555799999999999875 347789999999999999987 578999999999 989976
Q ss_pred CC
Q 020784 289 LD 290 (321)
Q Consensus 289 ~t 290 (321)
.+
T Consensus 289 ~s 290 (370)
T KOG1007|consen 289 SS 290 (370)
T ss_pred cc
Confidence 53
No 151
>KOG0307 consensus Vesicle coat complex COPII, subunit SEC31 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.57 E-value=8.9e-15 Score=144.05 Aligned_cols=201 Identities=16% Similarity=0.175 Sum_probs=148.7
Q ss_pred CCCCCCeEEEEEcCCCC-EEEEEcCCc-EEEEEecCCceeEEeee-ecCCceEEEEEecCC-CeEEEEeCCCCCCCCCCc
Q 020784 82 SSPPPTLLHISFNQDHG-CFAAGTDHG-FRIYNCDPFREIFRRDF-ERGGGIGVVEMLFRC-NILALVGGGPDPQYPLNK 157 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~-~lasg~~~g-v~vw~~~~~~~~~~~~~-~~~~~v~~v~~~~~~-~~~~~~sg~~~~~~~d~~ 157 (321)
..|.+.|+.+.|++.+. +||+|+++| |.|||+...+.-+...- .-...|.++.|.-.- ..++.++ .++.
T Consensus 113 ~~h~G~V~gLDfN~~q~nlLASGa~~geI~iWDlnn~~tP~~~~~~~~~~eI~~lsWNrkvqhILAS~s-------~sg~ 185 (1049)
T KOG0307|consen 113 SKHTGPVLGLDFNPFQGNLLASGADDGEILIWDLNKPETPFTPGSQAPPSEIKCLSWNRKVSHILASGS-------PSGR 185 (1049)
T ss_pred cccCCceeeeeccccCCceeeccCCCCcEEEeccCCcCCCCCCCCCCCcccceEeccchhhhHHhhccC-------CCCC
Confidence 56888999999999765 999999977 88999987654443310 013567777775432 2333333 5689
Q ss_pred EEEEeCCCCcEEEEEeeCC---ceeEEEEeCC---eEEEEEC----CEEEEEEcCC-cEEEEEEeccCCCCceEEEeeCC
Q 020784 158 VMIWDDHQSRCIGELSFRS---EVRSVKLRRD---RIIVVLE----QKIFVYNFAD-LKLLHQIETIANPKGLCAVSQGV 226 (321)
Q Consensus 158 v~iWD~~~~~~~~~~~~~~---~v~~v~~~~~---~~~~~~~----~~I~iwd~~~-~~~~~~l~~~~~~~~~~~~s~~~ 226 (321)
+.|||++..+.+..+.... .+..+.||++ .++++++ ..|.+||+|. ...++++++|...+..+++++..
T Consensus 186 ~~iWDlr~~~pii~ls~~~~~~~~S~l~WhP~~aTql~~As~dd~~PviqlWDlR~assP~k~~~~H~~GilslsWc~~D 265 (1049)
T KOG0307|consen 186 AVIWDLRKKKPIIKLSDTPGRMHCSVLAWHPDHATQLLVASGDDSAPVIQLWDLRFASSPLKILEGHQRGILSLSWCPQD 265 (1049)
T ss_pred ceeccccCCCcccccccCCCccceeeeeeCCCCceeeeeecCCCCCceeEeecccccCCchhhhcccccceeeeccCCCC
Confidence 9999999888776665544 3778999987 4667654 2899999974 45667777777665555555543
Q ss_pred CceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCC-EEEEEeCCCcEEEEEEcCCCc
Q 020784 227 GSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQ-LLATSSTKGTLVRIFNTLDGT 292 (321)
Q Consensus 227 d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~-~las~S~Dgt~IrIWd~~tg~ 292 (321)
..+++ |+..|+.|.+|+.+++. +..+....+.+..+.|+|... .||.+|.||. |-|+.+.++.
T Consensus 266 -~~lll-SsgkD~~ii~wN~~tgEvl~~~p~~~nW~fdv~w~pr~P~~~A~asfdgk-I~I~sl~~~~ 330 (1049)
T KOG0307|consen 266 -PRLLL-SSGKDNRIICWNPNTGEVLGELPAQGNWCFDVQWCPRNPSVMAAASFDGK-ISIYSLQGTD 330 (1049)
T ss_pred -chhhh-cccCCCCeeEecCCCceEeeecCCCCcceeeeeecCCCcchhhhheeccc-eeeeeeecCC
Confidence 24555 68889999999998876 457888888999999998765 8999999999 9999998754
No 152
>KOG0303 consensus Actin-binding protein Coronin, contains WD40 repeats [Cytoskeleton]
Probab=99.57 E-value=6.9e-13 Score=117.60 Aligned_cols=204 Identities=13% Similarity=0.140 Sum_probs=143.0
Q ss_pred CCcccCCCCCCeEEEEEcCC-CCEEEEEcCCc-EEEEEecCCce-------eEEeeeecCCceEEEEEecCCC-eEEEEe
Q 020784 77 AESTSSSPPPTLLHISFNQD-HGCFAAGTDHG-FRIYNCDPFRE-------IFRRDFERGGGIGVVEMLFRCN-ILALVG 146 (321)
Q Consensus 77 ~~~~~~~~~~~V~~v~fs~d-g~~lasg~~~g-v~vw~~~~~~~-------~~~~~~~~~~~v~~v~~~~~~~-~~~~~s 146 (321)
.+.+..+|.++|..++|+|- ...||+|++|. |.||.+..... +..... |...|+.|+|++... .+++++
T Consensus 73 ~~P~v~GHt~~vLDi~w~PfnD~vIASgSeD~~v~vW~IPe~~l~~~ltepvv~L~g-H~rrVg~V~wHPtA~NVLlsag 151 (472)
T KOG0303|consen 73 SYPLVCGHTAPVLDIDWCPFNDCVIASGSEDTKVMVWQIPENGLTRDLTEPVVELYG-HQRRVGLVQWHPTAPNVLLSAG 151 (472)
T ss_pred CCCCccCccccccccccCccCCceeecCCCCceEEEEECCCcccccCcccceEEEee-cceeEEEEeecccchhhHhhcc
Confidence 45566889999999999995 45789999976 77998744322 223333 678899999988654 444444
Q ss_pred CCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCeEEEE---ECCEEEEEEcCCcEEEEEEeccCCCCceEEEe
Q 020784 147 GGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDRIIVV---LEQKIFVYNFADLKLLHQIETIANPKGLCAVS 223 (321)
Q Consensus 147 g~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~~~~~---~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s 223 (321)
.|++|.|||+.+|+.+.++.+...|++++|+.++-.++ -|++|||||.++++.+..-..|.+....-++-
T Consensus 152 -------~Dn~v~iWnv~tgeali~l~hpd~i~S~sfn~dGs~l~TtckDKkvRv~dpr~~~~v~e~~~heG~k~~Raif 224 (472)
T KOG0303|consen 152 -------SDNTVSIWNVGTGEALITLDHPDMVYSMSFNRDGSLLCTTCKDKKVRVIDPRRGTVVSEGVAHEGAKPARAIF 224 (472)
T ss_pred -------CCceEEEEeccCCceeeecCCCCeEEEEEeccCCceeeeecccceeEEEcCCCCcEeeecccccCCCcceeEE
Confidence 47999999999999998999888999999998764443 35799999999999998876665543333322
Q ss_pred eCCCceEEEeecC---CCCcEEEEeeCC--cc--eEEeeccccceeEEEECCCCCEEEEEeC-CCcEEEEEEcCCCc
Q 020784 224 QGVGSLVLVCPGL---QKGQVRVEHYAS--KR--TKFIMAHDSRIACFALTQDGQLLATSST-KGTLVRIFNTLDGT 292 (321)
Q Consensus 224 ~~~d~~~la~sGs---~dg~V~i~d~~~--~~--~~~l~~H~~~V~~vafspdg~~las~S~-Dgt~IrIWd~~tg~ 292 (321)
-+++. ++.+|. .+..+-+||-.. .+ +.++.. .+.|.-=-|.+|..++--++. |+. ||.|.+..-.
T Consensus 225 -l~~g~-i~tTGfsr~seRq~aLwdp~nl~eP~~~~elDt-SnGvl~PFyD~dt~ivYl~GKGD~~-IRYyEit~d~ 297 (472)
T KOG0303|consen 225 -LASGK-IFTTGFSRMSERQIALWDPNNLEEPIALQELDT-SNGVLLPFYDPDTSIVYLCGKGDSS-IRYFEITNEP 297 (472)
T ss_pred -eccCc-eeeeccccccccceeccCcccccCcceeEEecc-CCceEEeeecCCCCEEEEEecCCcc-eEEEEecCCC
Confidence 22334 444464 366788888553 22 223333 334555556788776655544 777 9999998866
No 153
>KOG0322 consensus G-protein beta subunit-like protein GNB1L, contains WD repeats [General function prediction only]
Probab=99.57 E-value=5.3e-14 Score=118.76 Aligned_cols=62 Identities=15% Similarity=0.258 Sum_probs=55.6
Q ss_pred CCCceEEEeecCCCCcEEEEeeCCc-ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEc
Q 020784 225 GVGSLVLVCPGLQKGQVRVEHYASK-RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 225 ~~d~~~la~sGs~dg~V~i~d~~~~-~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~ 288 (321)
.+|++++| +.+=||.|||+.+++. ++.+|+.|...|++++|+|+..++|.+|.|++ |-+|++
T Consensus 260 RpD~KIlA-TAGWD~RiRVyswrtl~pLAVLkyHsagvn~vAfspd~~lmAaaskD~r-ISLWkL 322 (323)
T KOG0322|consen 260 RPDGKILA-TAGWDHRIRVYSWRTLNPLAVLKYHSAGVNAVAFSPDCELMAAASKDAR-ISLWKL 322 (323)
T ss_pred ccCCcEEe-ecccCCcEEEEEeccCCchhhhhhhhcceeEEEeCCCCchhhhccCCce-EEeeec
Confidence 46788998 4888999999888764 57899999999999999999999999999999 999986
No 154
>KOG4283 consensus Transcription-coupled repair protein CSA, contains WD40 domain [Transcription; Replication, recombination and repair]
Probab=99.57 E-value=1.7e-13 Score=117.48 Aligned_cols=164 Identities=15% Similarity=0.203 Sum_probs=115.5
Q ss_pred cCCceEEEEEecC-CCeEEEEeCCCCCCCCCCcEEEEeCCCCc------------EEEEEee----CCceeEEEEeCC--
Q 020784 126 RGGGIGVVEMLFR-CNILALVGGGPDPQYPLNKVMIWDDHQSR------------CIGELSF----RSEVRSVKLRRD-- 186 (321)
Q Consensus 126 ~~~~v~~v~~~~~-~~~~~~~sg~~~~~~~d~~v~iWD~~~~~------------~~~~~~~----~~~v~~v~~~~~-- 186 (321)
|++.|..+.+... +.++...+ .|+.|.+||+++-. |+...++ ...|..+.|-|.
T Consensus 42 HgGsvNsL~id~tegrymlSGg-------adgsi~v~Dl~n~t~~e~s~li~k~~c~v~~~h~~~Hky~iss~~WyP~Dt 114 (397)
T KOG4283|consen 42 HGGSVNSLQIDLTEGRYMLSGG-------ADGSIAVFDLQNATDYEASGLIAKHKCIVAKQHENGHKYAISSAIWYPIDT 114 (397)
T ss_pred CCCccceeeeccccceEEeecC-------CCccEEEEEeccccchhhccceeheeeeccccCCccceeeeeeeEEeeecC
Confidence 5788888877553 44443333 57999999987542 1101111 124666777552
Q ss_pred eEEEE--ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCC-ceEEEeecCCCCcEEEEeeCCcc-eEEeecccccee
Q 020784 187 RIIVV--LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVG-SLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIA 262 (321)
Q Consensus 187 ~~~~~--~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d-~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~ 262 (321)
+++.. .|.++++||..+.+....|+... .+...++++-.. .+++| .|..+-.|++-|++.+. .++|.+|...|.
T Consensus 115 GmFtssSFDhtlKVWDtnTlQ~a~~F~me~-~VYshamSp~a~sHcLiA-~gtr~~~VrLCDi~SGs~sH~LsGHr~~vl 192 (397)
T KOG4283|consen 115 GMFTSSSFDHTLKVWDTNTLQEAVDFKMEG-KVYSHAMSPMAMSHCLIA-AGTRDVQVRLCDIASGSFSHTLSGHRDGVL 192 (397)
T ss_pred ceeecccccceEEEeecccceeeEEeecCc-eeehhhcChhhhcceEEE-EecCCCcEEEEeccCCcceeeeccccCceE
Confidence 33333 46899999999988888776542 233444444332 46777 49999999999998877 579999999999
Q ss_pred EEEECCCCC-EEEEEeCCCcEEEEEEcCCC-cEEEEEeC
Q 020784 263 CFALTQDGQ-LLATSSTKGTLVRIFNTLDG-TLLQEECC 299 (321)
Q Consensus 263 ~vafspdg~-~las~S~Dgt~IrIWd~~tg-~~i~~~~~ 299 (321)
+|.|+|... .|||||.||. ||+||++.. -|+..+..
T Consensus 193 aV~Wsp~~e~vLatgsaDg~-irlWDiRrasgcf~~lD~ 230 (397)
T KOG4283|consen 193 AVEWSPSSEWVLATGSADGA-IRLWDIRRASGCFRVLDQ 230 (397)
T ss_pred EEEeccCceeEEEecCCCce-EEEEEeecccceeEEeec
Confidence 999999865 5899999999 999999875 56666643
No 155
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=99.56 E-value=6.2e-12 Score=115.03 Aligned_cols=222 Identities=13% Similarity=0.067 Sum_probs=140.4
Q ss_pred CeEEEEEcCCCCEEEEEcC--CcEEEEEecC-CceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeC
Q 020784 87 TLLHISFNQDHGCFAAGTD--HGFRIYNCDP-FREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDD 163 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~--~gv~vw~~~~-~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~ 163 (321)
....++|+|||++|++++. ++|.+|+++. ++..........+....+.+.++++.++++.. .++.|.+||+
T Consensus 36 ~~~~l~~spd~~~lyv~~~~~~~i~~~~~~~~g~l~~~~~~~~~~~p~~i~~~~~g~~l~v~~~------~~~~v~v~~~ 109 (330)
T PRK11028 36 QVQPMVISPDKRHLYVGVRPEFRVLSYRIADDGALTFAAESPLPGSPTHISTDHQGRFLFSASY------NANCVSVSPL 109 (330)
T ss_pred CCccEEECCCCCEEEEEECCCCcEEEEEECCCCceEEeeeecCCCCceEEEECCCCCEEEEEEc------CCCeEEEEEE
Confidence 4567899999999877654 5688999873 33322222212345567788888888887763 3589999998
Q ss_pred CC-Cc---EEEEEeeCCceeEEEEeCC--eEEEEE--CCEEEEEEcCCcEEEE-------EEeccCCCCceEEEeeCCCc
Q 020784 164 HQ-SR---CIGELSFRSEVRSVKLRRD--RIIVVL--EQKIFVYNFADLKLLH-------QIETIANPKGLCAVSQGVGS 228 (321)
Q Consensus 164 ~~-~~---~~~~~~~~~~v~~v~~~~~--~~~~~~--~~~I~iwd~~~~~~~~-------~l~~~~~~~~~~~~s~~~d~ 228 (321)
++ +. .+..+.....+..+.++++ .++++. ++.|.+||+.+...+. .+.....+ .-+.|+ +|+
T Consensus 110 ~~~g~~~~~~~~~~~~~~~~~~~~~p~g~~l~v~~~~~~~v~v~d~~~~g~l~~~~~~~~~~~~g~~p-~~~~~~--pdg 186 (330)
T PRK11028 110 DKDGIPVAPIQIIEGLEGCHSANIDPDNRTLWVPCLKEDRIRLFTLSDDGHLVAQEPAEVTTVEGAGP-RHMVFH--PNQ 186 (330)
T ss_pred CCCCCCCCceeeccCCCcccEeEeCCCCCEEEEeeCCCCEEEEEEECCCCcccccCCCceecCCCCCC-ceEEEC--CCC
Confidence 74 22 2333333345677778875 454443 4799999997633221 11122222 234554 555
Q ss_pred eEEEeecCCCCcEEEEeeCC--cceE---Eeecc------ccceeEEEECCCCCEEEEEeC-CCcEEEEEEcCCC----c
Q 020784 229 LVLVCPGLQKGQVRVEHYAS--KRTK---FIMAH------DSRIACFALTQDGQLLATSST-KGTLVRIFNTLDG----T 292 (321)
Q Consensus 229 ~~la~sGs~dg~V~i~d~~~--~~~~---~l~~H------~~~V~~vafspdg~~las~S~-Dgt~IrIWd~~tg----~ 292 (321)
.++.++...++.|.+|++.. +.+. .+..+ ......++|+|+|++|.++.. +++ |.+|++.+. +
T Consensus 187 ~~lyv~~~~~~~v~v~~~~~~~~~~~~~~~~~~~p~~~~~~~~~~~i~~~pdg~~lyv~~~~~~~-I~v~~i~~~~~~~~ 265 (330)
T PRK11028 187 QYAYCVNELNSSVDVWQLKDPHGEIECVQTLDMMPADFSDTRWAADIHITPDGRHLYACDRTASL-ISVFSVSEDGSVLS 265 (330)
T ss_pred CEEEEEecCCCEEEEEEEeCCCCCEEEEEEEecCCCcCCCCccceeEEECCCCCEEEEecCCCCe-EEEEEEeCCCCeEE
Confidence 66655455588999999863 2222 22211 223446999999999888855 566 999999542 2
Q ss_pred EEEEEeCCCcceeEEEeecCceEEEe
Q 020784 293 LLQEECCPSISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 293 ~i~~~~~g~~~~~~~~s~d~~~la~~ 318 (321)
.+.....+.....+.+++||++|.++
T Consensus 266 ~~~~~~~~~~p~~~~~~~dg~~l~va 291 (330)
T PRK11028 266 FEGHQPTETQPRGFNIDHSGKYLIAA 291 (330)
T ss_pred EeEEEeccccCCceEECCCCCEEEEE
Confidence 44555555555677899999999885
No 156
>KOG0302 consensus Ribosome Assembly protein [General function prediction only]
Probab=99.54 E-value=3.4e-13 Score=118.91 Aligned_cols=194 Identities=10% Similarity=0.168 Sum_probs=140.4
Q ss_pred CCCCCCeEEEEEcC--CCCEEEEEcC-CcEEEEEecCCceeEE-eeee-cCCceEEEEEecCC-CeEEEEeCCCCCCCCC
Q 020784 82 SSPPPTLLHISFNQ--DHGCFAAGTD-HGFRIYNCDPFREIFR-RDFE-RGGGIGVVEMLFRC-NILALVGGGPDPQYPL 155 (321)
Q Consensus 82 ~~~~~~V~~v~fs~--dg~~lasg~~-~gv~vw~~~~~~~~~~-~~~~-~~~~v~~v~~~~~~-~~~~~~sg~~~~~~~d 155 (321)
..|...=+.++||| .|+ |++|.. ++|++|...++..... +.+. |...|..++|++.- +.++.++ .|
T Consensus 208 ~ghk~EGy~LdWSp~~~g~-LlsGDc~~~I~lw~~~~g~W~vd~~Pf~gH~~SVEDLqWSptE~~vfaScS-------~D 279 (440)
T KOG0302|consen 208 NGHKGEGYGLDWSPIKTGR-LLSGDCVKGIHLWEPSTGSWKVDQRPFTGHTKSVEDLQWSPTEDGVFASCS-------CD 279 (440)
T ss_pred cccCccceeeecccccccc-cccCccccceEeeeeccCceeecCccccccccchhhhccCCccCceEEeee-------cC
Confidence 35666778999999 444 677776 7799999887654332 2221 67788888998854 4555555 68
Q ss_pred CcEEEEeCCCC---cEEEEEeeCCceeEEEEeCCeEEEE--EC-CEEEEEEcCC---cEEEEEEeccCCCCceEEEeeCC
Q 020784 156 NKVMIWDDHQS---RCIGELSFRSEVRSVKLRRDRIIVV--LE-QKIFVYNFAD---LKLLHQIETIANPKGLCAVSQGV 226 (321)
Q Consensus 156 ~~v~iWD~~~~---~~~~~~~~~~~v~~v~~~~~~~~~~--~~-~~I~iwd~~~---~~~~~~l~~~~~~~~~~~~s~~~ 226 (321)
+.|+|||++.+ .++..-.+.+.|..+.|+.+.-+++ .| ++++|||+++ ++.+.+|+.|..++.++.+++..
T Consensus 280 gsIrIWDiRs~~~~~~~~~kAh~sDVNVISWnr~~~lLasG~DdGt~~iwDLR~~~~~~pVA~fk~Hk~pItsieW~p~e 359 (440)
T KOG0302|consen 280 GSIRIWDIRSGPKKAAVSTKAHNSDVNVISWNRREPLLASGGDDGTLSIWDLRQFKSGQPVATFKYHKAPITSIEWHPHE 359 (440)
T ss_pred ceEEEEEecCCCccceeEeeccCCceeeEEccCCcceeeecCCCceEEEEEhhhccCCCcceeEEeccCCeeEEEecccc
Confidence 99999999987 4566656677899999998754333 33 6999999975 56778999999999999999987
Q ss_pred CceEEEeecCCCCcEEEEeeCCcce-----------------EEeecc--ccceeEEEECCC-CCEEEEEeCCCcEEEEE
Q 020784 227 GSLVLVCPGLQKGQVRVEHYASKRT-----------------KFIMAH--DSRIACFALTQD-GQLLATSSTKGTLVRIF 286 (321)
Q Consensus 227 d~~~la~sGs~dg~V~i~d~~~~~~-----------------~~l~~H--~~~V~~vafspd-g~~las~S~Dgt~IrIW 286 (321)
+..+.| ++.|..|.|||+....- ..+--| ...|..|.|++. ..+|+|.+.||- .||
T Consensus 360 ~s~iaa--sg~D~QitiWDlsvE~D~ee~~~~a~~~L~dlPpQLLFVHqGQke~KevhWH~QiPG~lvsTa~dGf--nVf 435 (440)
T KOG0302|consen 360 DSVIAA--SGEDNQITIWDLSVEADEEEIDQEAAEGLQDLPPQLLFVHQGQKEVKEVHWHRQIPGLLVSTAIDGF--NVF 435 (440)
T ss_pred CceEEe--ccCCCcEEEEEeeccCChhhhccccccchhcCCceeEEEecchhHhhhheeccCCCCeEEEecccce--eEE
Confidence 655444 67788999999863210 122235 456899999976 457888888875 566
Q ss_pred E
Q 020784 287 N 287 (321)
Q Consensus 287 d 287 (321)
-
T Consensus 436 k 436 (440)
T KOG0302|consen 436 K 436 (440)
T ss_pred E
Confidence 4
No 157
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=99.53 E-value=1.8e-12 Score=111.71 Aligned_cols=192 Identities=14% Similarity=0.144 Sum_probs=134.2
Q ss_pred CCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 83 SPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
.....|.++.|++.+..|++++-|| +++|++.......... |++++..+++.. ....++.+ .||+|+.+
T Consensus 11 pP~d~IS~v~f~~~~~~LLvssWDgslrlYdv~~~~l~~~~~--~~~plL~c~F~d-~~~~~~G~-------~dg~vr~~ 80 (323)
T KOG1036|consen 11 PPEDGISSVKFSPSSSDLLVSSWDGSLRLYDVPANSLKLKFK--HGAPLLDCAFAD-ESTIVTGG-------LDGQVRRY 80 (323)
T ss_pred CChhceeeEEEcCcCCcEEEEeccCcEEEEeccchhhhhhee--cCCceeeeeccC-CceEEEec-------cCceEEEE
Confidence 3446899999999887777666654 8999998875543433 578887777654 22333333 58999999
Q ss_pred eCCCCcEEEEEeeCCceeEEEEeC--CeEEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCC
Q 020784 162 DDHQSRCIGELSFRSEVRSVKLRR--DRIIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQK 238 (321)
Q Consensus 162 D~~~~~~~~~~~~~~~v~~v~~~~--~~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~d 238 (321)
|+.++.....-.+...|.+++..+ +.++.+ .|++|++||.++...+-++... ..+.+.+..+ ..|++ |..+
T Consensus 81 Dln~~~~~~igth~~~i~ci~~~~~~~~vIsgsWD~~ik~wD~R~~~~~~~~d~~---kkVy~~~v~g--~~LvV-g~~~ 154 (323)
T KOG1036|consen 81 DLNTGNEDQIGTHDEGIRCIEYSYEVGCVISGSWDKTIKFWDPRNKVVVGTFDQG---KKVYCMDVSG--NRLVV-GTSD 154 (323)
T ss_pred EecCCcceeeccCCCceEEEEeeccCCeEEEcccCccEEEEeccccccccccccC---ceEEEEeccC--CEEEE-eecC
Confidence 999988766667778899999874 333333 5789999999975544444433 2444555443 34443 8889
Q ss_pred CcEEEEeeCCcceEE---eeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCC
Q 020784 239 GQVRVEHYASKRTKF---IMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDG 291 (321)
Q Consensus 239 g~V~i~d~~~~~~~~---l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg 291 (321)
..|.|||+.+..... -..-+-.++||++-|++.=+|.+|-||. |-|=.+...
T Consensus 155 r~v~iyDLRn~~~~~q~reS~lkyqtR~v~~~pn~eGy~~sSieGR-VavE~~d~s 209 (323)
T KOG1036|consen 155 RKVLIYDLRNLDEPFQRRESSLKYQTRCVALVPNGEGYVVSSIEGR-VAVEYFDDS 209 (323)
T ss_pred ceEEEEEcccccchhhhccccceeEEEEEEEecCCCceEEEeecce-EEEEccCCc
Confidence 999999987643221 1234456899999999888889999998 877655544
No 158
>KOG2096 consensus WD40 repeat protein [General function prediction only]
Probab=99.53 E-value=1e-12 Score=113.71 Aligned_cols=218 Identities=14% Similarity=0.114 Sum_probs=140.9
Q ss_pred eEEEEEcCCCCEEEEEcC--CcEEEEEecCC---ceeEE------eeee--cCCceEEEEEecCCCeEEEEeCCCCCCCC
Q 020784 88 LLHISFNQDHGCFAAGTD--HGFRIYNCDPF---REIFR------RDFE--RGGGIGVVEMLFRCNILALVGGGPDPQYP 154 (321)
Q Consensus 88 V~~v~fs~dg~~lasg~~--~gv~vw~~~~~---~~~~~------~~~~--~~~~v~~v~~~~~~~~~~~~sg~~~~~~~ 154 (321)
-+.|.|.||-+-++..-. +.+++|.+... +..+. .++. |.-.+..+-+...+..+++++ .
T Consensus 135 pT~V~FapDc~s~vv~~~~g~~l~vyk~~K~~dG~~~~~~v~~D~~~f~~kh~v~~i~iGiA~~~k~imsas-------~ 207 (420)
T KOG2096|consen 135 PTRVVFAPDCKSVVVSVKRGNKLCVYKLVKKTDGSGSHHFVHIDNLEFERKHQVDIINIGIAGNAKYIMSAS-------L 207 (420)
T ss_pred ceEEEECCCcceEEEEEccCCEEEEEEeeecccCCCCcccccccccccchhcccceEEEeecCCceEEEEec-------C
Confidence 567999999886665443 56889876422 11110 1111 122233333344455566665 6
Q ss_pred CCcEEEEeCCCCcEEEEEeeCC-ceeEEEEeCCeEEEEE---CCEEEEEEc---CCc-----EEEEEEeccCCCCceEEE
Q 020784 155 LNKVMIWDDHQSRCIGELSFRS-EVRSVKLRRDRIIVVL---EQKIFVYNF---ADL-----KLLHQIETIANPKGLCAV 222 (321)
Q Consensus 155 d~~v~iWD~~~~~~~~~~~~~~-~v~~v~~~~~~~~~~~---~~~I~iwd~---~~~-----~~~~~l~~~~~~~~~~~~ 222 (321)
|.+|.+||++ |+.+..+.... .-+..+++|++.+++. .-.|++|.+ .+| ..+..+++|...+...+|
T Consensus 208 dt~i~lw~lk-Gq~L~~idtnq~~n~~aavSP~GRFia~~gFTpDVkVwE~~f~kdG~fqev~rvf~LkGH~saV~~~aF 286 (420)
T KOG2096|consen 208 DTKICLWDLK-GQLLQSIDTNQSSNYDAAVSPDGRFIAVSGFTPDVKVWEPIFTKDGTFQEVKRVFSLKGHQSAVLAAAF 286 (420)
T ss_pred CCcEEEEecC-CceeeeeccccccccceeeCCCCcEEEEecCCCCceEEEEEeccCcchhhhhhhheeccchhheeeeee
Confidence 7999999998 88887776543 3444566666433332 348999987 222 223356777776666677
Q ss_pred eeCCCceEEEeecCCCCcEEEEeeCCc--------ceEEe----eccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 223 SQGVGSLVLVCPGLQKGQVRVEHYASK--------RTKFI----MAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 223 s~~~d~~~la~sGs~dg~V~i~d~~~~--------~~~~l----~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
+++. .-++ +.+.||+++|||..-+ .+++. .+-.+....++++|+|+.||... ..+ +++|..++
T Consensus 287 sn~S--~r~v-tvSkDG~wriwdtdVrY~~~qDpk~Lk~g~~pl~aag~~p~RL~lsP~g~~lA~s~-gs~-l~~~~se~ 361 (420)
T KOG2096|consen 287 SNSS--TRAV-TVSKDGKWRIWDTDVRYEAGQDPKILKEGSAPLHAAGSEPVRLELSPSGDSLAVSF-GSD-LKVFASED 361 (420)
T ss_pred CCCc--ceeE-EEecCCcEEEeeccceEecCCCchHhhcCCcchhhcCCCceEEEeCCCCcEEEeec-CCc-eEEEEccc
Confidence 6654 5555 5799999999986411 12222 22334455899999999998654 556 99999999
Q ss_pred CcEEEEEeCCCcceeE--EEeecCceEEEe
Q 020784 291 GTLLQEECCPSISAQS--GLWLSSAWLRVL 318 (321)
Q Consensus 291 g~~i~~~~~g~~~~~~--~~s~d~~~la~~ 318 (321)
|+...++++.|...+. +++.+|+|+|.+
T Consensus 362 g~~~~~~e~~h~~~Is~is~~~~g~~~atc 391 (420)
T KOG2096|consen 362 GKDYPELEDIHSTTISSISYSSDGKYIATC 391 (420)
T ss_pred CccchhHHHhhcCceeeEEecCCCcEEeee
Confidence 9999888877776654 667888999874
No 159
>KOG2919 consensus Guanine nucleotide-binding protein [General function prediction only]
Probab=99.53 E-value=3.2e-13 Score=117.07 Aligned_cols=192 Identities=19% Similarity=0.198 Sum_probs=138.8
Q ss_pred CeEEEEEcCCCCEEEEEcCCcEEEEEe-cCCceeEEe------eeecCCceEEEEEecCCC-eEEEEeCCCCCCCCCCcE
Q 020784 87 TLLHISFNQDHGCFAAGTDHGFRIYNC-DPFREIFRR------DFERGGGIGVVEMLFRCN-ILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~~gv~vw~~-~~~~~~~~~------~~~~~~~v~~v~~~~~~~-~~~~~sg~~~~~~~d~~v 158 (321)
.-.|++|+|||..|.+|-.+.|+|||+ .+++..-.+ ++...+-+.++++++... .+++.+ .-+.+
T Consensus 160 aAhsL~Fs~DGeqlfaGykrcirvFdt~RpGr~c~vy~t~~~~k~gq~giisc~a~sP~~~~~~a~gs-------Y~q~~ 232 (406)
T KOG2919|consen 160 AAHSLQFSPDGEQLFAGYKRCIRVFDTSRPGRDCPVYTTVTKGKFGQKGIISCFAFSPMDSKTLAVGS-------YGQRV 232 (406)
T ss_pred hheeEEecCCCCeEeecccceEEEeeccCCCCCCcchhhhhcccccccceeeeeeccCCCCcceeeec-------cccee
Confidence 346899999999999999999999998 444322111 111134556667766544 555555 34778
Q ss_pred EEEeCCCCcEEEEEeeC-CceeEEEEeCC--eEEEEE--CCEEEEEEcCC-cEEEEEEeccCC-CCceEEEeeCCCceEE
Q 020784 159 MIWDDHQSRCIGELSFR-SEVRSVKLRRD--RIIVVL--EQKIFVYNFAD-LKLLHQIETIAN-PKGLCAVSQGVGSLVL 231 (321)
Q Consensus 159 ~iWD~~~~~~~~~~~~~-~~v~~v~~~~~--~~~~~~--~~~I~iwd~~~-~~~~~~l~~~~~-~~~~~~~s~~~d~~~l 231 (321)
-|+.-..+..+..+..+ +-|+-++|+++ +++++. +.+|..||++. .+.+..+..|.. ....+-|..++++.+|
T Consensus 233 giy~~~~~~pl~llggh~gGvThL~~~edGn~lfsGaRk~dkIl~WDiR~~~~pv~~L~rhv~~TNQRI~FDld~~~~~L 312 (406)
T KOG2919|consen 233 GIYNDDGRRPLQLLGGHGGGVTHLQWCEDGNKLFSGARKDDKILCWDIRYSRDPVYALERHVGDTNQRILFDLDPKGEIL 312 (406)
T ss_pred eeEecCCCCceeeecccCCCeeeEEeccCcCeecccccCCCeEEEEeehhccchhhhhhhhccCccceEEEecCCCCcee
Confidence 88887777766665544 57999999875 566654 56999999975 556666766654 3345666777788999
Q ss_pred EeecCCCCcEEEEeeCC-cc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 232 VCPGLQKGQVRVEHYAS-KR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 232 a~sGs~dg~V~i~d~~~-~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
| +|+.||.|++||++. +. ...+..|+..|+.|+++|--.++||+|-. |+|-..+
T Consensus 313 a-sG~tdG~V~vwdlk~~gn~~sv~~~~sd~vNgvslnP~mpilatssGq----r~f~~~~ 368 (406)
T KOG2919|consen 313 A-SGDTDGSVRVWDLKDLGNEVSVTGNYSDTVNGVSLNPIMPILATSSGQ----RIFKYPK 368 (406)
T ss_pred e-ccCCCccEEEEecCCCCCcccccccccccccceecCcccceeeeccCc----eeecCCC
Confidence 9 699999999999876 33 66888999999999999999999998733 4564443
No 160
>COG2319 FOG: WD40 repeat [General function prediction only]
Probab=99.52 E-value=4.1e-11 Score=109.76 Aligned_cols=227 Identities=17% Similarity=0.244 Sum_probs=159.6
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCc-eeEEeeeecCCceEEEEE-ecCCCeEEEEeCCCCCCCCCCc
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFR-EIFRRDFERGGGIGVVEM-LFRCNILALVGGGPDPQYPLNK 157 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~-~~~~~~~~~~~~v~~v~~-~~~~~~~~~~sg~~~~~~~d~~ 157 (321)
...+...|.++.|.+++..++.++. ..+.+|+..... ........+...+..+.. ..+...++...+. .|+.
T Consensus 61 ~~~~~~~i~~~~~~~~~~~~~~~~~d~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-----~d~~ 135 (466)
T COG2319 61 LRGHEDSITSIAFSPDGELLLSGSSDGTIKLWDLDNGEKLIKSLEGLHDSSVSKLALSSPDGNSILLASSS-----LDGT 135 (466)
T ss_pred eeeccceEEEEEECCCCcEEEEecCCCcEEEEEcCCCceeEEEEeccCCCceeeEEEECCCcceEEeccCC-----CCcc
Confidence 4567789999999999999998875 568899988775 332332201124555555 4445533333322 3789
Q ss_pred EEEEeCCC-CcEEEEEeeC-CceeEEEEeCCe--EEEEE--CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEE
Q 020784 158 VMIWDDHQ-SRCIGELSFR-SEVRSVKLRRDR--IIVVL--EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVL 231 (321)
Q Consensus 158 v~iWD~~~-~~~~~~~~~~-~~v~~v~~~~~~--~~~~~--~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~l 231 (321)
+++||... ......+..+ ..|..+.|+++. ++.+. ++.+++|++..+..+..+..|...+..+++++ ++..+
T Consensus 136 ~~~~~~~~~~~~~~~~~~~~~~v~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~~~--~~~~~ 213 (466)
T COG2319 136 VKLWDLSTPGKLIRTLEGHSESVTSLAFSPDGKLLASGSSLDGTIKLWDLRTGKPLSTLAGHTDPVSSLAFSP--DGGLL 213 (466)
T ss_pred EEEEEecCCCeEEEEEecCcccEEEEEECCCCCEEEecCCCCCceEEEEcCCCceEEeeccCCCceEEEEEcC--CcceE
Confidence 99999987 5555555544 578889998865 33333 67999999998888888888777777777774 44434
Q ss_pred EeecCCCCcEEEEeeCCcce-E-EeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcE-EEEEeCCCcceeE--
Q 020784 232 VCPGLQKGQVRVEHYASKRT-K-FIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTL-LQEECCPSISAQS-- 306 (321)
Q Consensus 232 a~sGs~dg~V~i~d~~~~~~-~-~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~-i~~~~~g~~~~~~-- 306 (321)
+.+++.|+.|++|+...+.. . .+.+|...+ ...|++++.++++++.|+. +++|++..... +..+ .++.....
T Consensus 214 ~~~~~~d~~i~~wd~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~d~~-~~~~~~~~~~~~~~~~-~~~~~~v~~~ 290 (466)
T COG2319 214 IASGSSDGTIRLWDLSTGKLLRSTLSGHSDSV-VSSFSPDGSLLASGSSDGT-IRLWDLRSSSSLLRTL-SGHSSSVLSV 290 (466)
T ss_pred EEEecCCCcEEEEECCCCcEEeeecCCCCcce-eEeECCCCCEEEEecCCCc-EEEeeecCCCcEEEEE-ecCCccEEEE
Confidence 43468999999998775553 3 588898886 4489999999999999999 99999997765 5555 45543333
Q ss_pred EEeecCceEEE
Q 020784 307 GLWLSSAWLRV 317 (321)
Q Consensus 307 ~~s~d~~~la~ 317 (321)
.+.+++.+++.
T Consensus 291 ~~~~~~~~~~~ 301 (466)
T COG2319 291 AFSPDGKLLAS 301 (466)
T ss_pred EECCCCCEEEE
Confidence 44454566654
No 161
>KOG0644 consensus Uncharacterized conserved protein, contains WD40 repeat and BROMO domains [General function prediction only]
Probab=99.51 E-value=4.3e-14 Score=135.13 Aligned_cols=224 Identities=10% Similarity=0.099 Sum_probs=156.1
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
.+|.+.|+|+.|...|.++++|+++- |+||.+++..+...... |.+.+..+++..+.-.++.++ .|.-|++
T Consensus 187 lgH~naVyca~fDrtg~~Iitgsdd~lvKiwS~et~~~lAs~rG-hs~ditdlavs~~n~~iaaaS-------~D~vIrv 258 (1113)
T KOG0644|consen 187 LGHRNAVYCAIFDRTGRYIITGSDDRLVKIWSMETARCLASCRG-HSGDITDLAVSSNNTMIAAAS-------NDKVIRV 258 (1113)
T ss_pred HhhhhheeeeeeccccceEeecCccceeeeeeccchhhhccCCC-Cccccchhccchhhhhhhhcc-------cCceEEE
Confidence 67889999999999999999999966 77999999887655554 677888877765544445444 6889999
Q ss_pred EeCCCCcEEEEEee-CCceeEEEEeCCeEEEEECCEEEEEEcCC--------------cEEEEEEeccCC----------
Q 020784 161 WDDHQSRCIGELSF-RSEVRSVKLRRDRIIVVLEQKIFVYNFAD--------------LKLLHQIETIAN---------- 215 (321)
Q Consensus 161 WD~~~~~~~~~~~~-~~~v~~v~~~~~~~~~~~~~~I~iwd~~~--------------~~~~~~l~~~~~---------- 215 (321)
|-+..+..+.-+.. .+.|++++|++.. ...-++++++||.+- +.++..+.....
T Consensus 259 Wrl~~~~pvsvLrghtgavtaiafsP~~-sss~dgt~~~wd~r~~~~~y~prp~~~~~~~~~~s~~~~~~~~~f~Tgs~d 337 (1113)
T KOG0644|consen 259 WRLPDGAPVSVLRGHTGAVTAIAFSPRA-SSSDDGTCRIWDARLEPRIYVPRPLKFTEKDLVDSILFENNGDRFLTGSRD 337 (1113)
T ss_pred EecCCCchHHHHhccccceeeeccCccc-cCCCCCceEeccccccccccCCCCCCcccccceeeeeccccccccccccCC
Confidence 99999987766654 4689999999866 223357999999871 111111110000
Q ss_pred ------CCceEEEeeCCCceEEEe----------ecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCC-CCEEEEEe
Q 020784 216 ------PKGLCAVSQGVGSLVLVC----------PGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQD-GQLLATSS 277 (321)
Q Consensus 216 ------~~~~~~~s~~~d~~~la~----------sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspd-g~~las~S 277 (321)
...+++. .....+++. +.-.+-.+++|++.++. ++.+.+|...+.-+.++|- .+...+++
T Consensus 338 ~ea~n~e~~~l~~--~~~~lif~t~ssd~~~~~~~ar~~~~~~vwnl~~g~l~H~l~ghsd~~yvLd~Hpfn~ri~msag 415 (1113)
T KOG0644|consen 338 GEARNHEFEQLAW--RSNLLIFVTRSSDLSSIVVTARNDHRLCVWNLYTGQLLHNLMGHSDEVYVLDVHPFNPRIAMSAG 415 (1113)
T ss_pred cccccchhhHhhh--hccceEEEeccccccccceeeeeeeEeeeeecccchhhhhhcccccceeeeeecCCCcHhhhhcc
Confidence 0001111 111122221 12223345558877765 5688999999999999985 45667899
Q ss_pred CCCcEEEEEEcCCCcEEEEEeCCCcceeE-EEeecCceEEE
Q 020784 278 TKGTLVRIFNTLDGTLLQEECCPSISAQS-GLWLSSAWLRV 317 (321)
Q Consensus 278 ~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~-~~s~d~~~la~ 317 (321)
.||. +-|||+-.|..++.+..|+.+..- .||.||+-+++
T Consensus 416 ~dgs-t~iwdi~eg~pik~y~~gh~kl~d~kFSqdgts~~l 455 (1113)
T KOG0644|consen 416 YDGS-TIIWDIWEGIPIKHYFIGHGKLVDGKFSQDGTSIAL 455 (1113)
T ss_pred CCCc-eEeeecccCCcceeeecccceeeccccCCCCceEec
Confidence 9999 889999999999999888765544 88999876654
No 162
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=99.51 E-value=8.9e-12 Score=117.14 Aligned_cols=199 Identities=14% Similarity=0.140 Sum_probs=147.8
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
......|.+++|.+.|++|.+|.+..|.-||+.+.+..+.... .++.|-.++.++....+++.+ +||.+...
T Consensus 66 g~~drsIE~L~W~e~~RLFS~g~sg~i~EwDl~~lk~~~~~d~-~gg~IWsiai~p~~~~l~Igc-------ddGvl~~~ 137 (691)
T KOG2048|consen 66 GPEDRSIESLAWAEGGRLFSSGLSGSITEWDLHTLKQKYNIDS-NGGAIWSIAINPENTILAIGC-------DDGVLYDF 137 (691)
T ss_pred cCCCCceeeEEEccCCeEEeecCCceEEEEecccCceeEEecC-CCcceeEEEeCCccceEEeec-------CCceEEEE
Confidence 3444689999999888888888888889999999998877765 467888888888888887776 67877777
Q ss_pred eCCCCcEEEEEee---CCceeEEEEeCCeE--EEEE-CCEEEEEEcCCcEEEEEEecc-----C-CCCceEEEeeCCCce
Q 020784 162 DDHQSRCIGELSF---RSEVRSVKLRRDRI--IVVL-EQKIFVYNFADLKLLHQIETI-----A-NPKGLCAVSQGVGSL 229 (321)
Q Consensus 162 D~~~~~~~~~~~~---~~~v~~v~~~~~~~--~~~~-~~~I~iwd~~~~~~~~~l~~~-----~-~~~~~~~~s~~~d~~ 229 (321)
+...+.....-.+ .+.|.++.|+++.. +.++ |+.|++||...++.++.+... . .+..+.++-.=-++
T Consensus 138 s~~p~~I~~~r~l~rq~sRvLslsw~~~~~~i~~Gs~Dg~Iriwd~~~~~t~~~~~~~~d~l~k~~~~iVWSv~~Lrd~- 216 (691)
T KOG2048|consen 138 SIGPDKITYKRSLMRQKSRVLSLSWNPTGTKIAGGSIDGVIRIWDVKSGQTLHIITMQLDRLSKREPTIVWSVLFLRDS- 216 (691)
T ss_pred ecCCceEEEEeecccccceEEEEEecCCccEEEecccCceEEEEEcCCCceEEEeeecccccccCCceEEEEEEEeecC-
Confidence 7777665444332 35799999999765 4444 457999999988877733221 1 22223333222233
Q ss_pred EEEeecCCCCcEEEEeeCCcce-EEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 230 VLVCPGLQKGQVRVEHYASKRT-KFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 230 ~la~sGs~dg~V~i~d~~~~~~-~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
.|| +|+.-|+|.+||...+.+ ..++.|...|.|++-.+++.+|.+++.|+.++++.....
T Consensus 217 tI~-sgDS~G~V~FWd~~~gTLiqS~~~h~adVl~Lav~~~~d~vfsaGvd~~ii~~~~~~~ 277 (691)
T KOG2048|consen 217 TIA-SGDSAGTVTFWDSIFGTLIQSHSCHDADVLALAVADNEDRVFSAGVDPKIIQYSLTTN 277 (691)
T ss_pred cEE-EecCCceEEEEcccCcchhhhhhhhhcceeEEEEcCCCCeEEEccCCCceEEEEecCC
Confidence 455 599999999999988774 478899999999999999999999999999554444333
No 163
>KOG0642 consensus Cell-cycle nuclear protein, contains WD-40 repeats [Cell cycle control, cell division, chromosome partitioning]
Probab=99.51 E-value=2e-13 Score=125.73 Aligned_cols=206 Identities=15% Similarity=0.167 Sum_probs=140.8
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCc----------eeEEeeeecCCceEEEEEecCCCeEEEEeCCCC
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFR----------EIFRRDFERGGGIGVVEMLFRCNILALVGGGPD 150 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~----------~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~ 150 (321)
+.|.++|.|++..++|..+.+|+-|| |+.|++.... ....... |.+.+..++++.....++.++
T Consensus 341 raH~gPVl~v~v~~n~~~~ysgg~Dg~I~~w~~p~n~dp~ds~dp~vl~~~l~G-htdavw~l~~s~~~~~Llscs---- 415 (577)
T KOG0642|consen 341 RAHEGPVLCVVVPSNGEHCYSGGIDGTIRCWNLPPNQDPDDSYDPSVLSGTLLG-HTDAVWLLALSSTKDRLLSCS---- 415 (577)
T ss_pred ecccCceEEEEecCCceEEEeeccCceeeeeccCCCCCcccccCcchhccceec-cccceeeeeecccccceeeec----
Confidence 78999999999999999999999866 8899763211 1111222 566777777777666677777
Q ss_pred CCCCCCcEEEEeCCCCcE--EEEEeeCCceeEEEEeCCeEEEE-ECCEEEEEEcCCcEEEEEE---eccCCC-----Cce
Q 020784 151 PQYPLNKVMIWDDHQSRC--IGELSFRSEVRSVKLRRDRIIVV-LEQKIFVYNFADLKLLHQI---ETIANP-----KGL 219 (321)
Q Consensus 151 ~~~~d~~v~iWD~~~~~~--~~~~~~~~~v~~v~~~~~~~~~~-~~~~I~iwd~~~~~~~~~l---~~~~~~-----~~~ 219 (321)
.||+|++|+...... ...-+-++..+++.+...+.+.. .+...+.+++.+++....+ .....+ -.+
T Consensus 416 ---~DgTvr~w~~~~~~~~~f~~~~e~g~Plsvd~~ss~~a~~~~s~~~~~~~~~~~ev~s~~~~~~s~~~~~~~~~~~i 492 (577)
T KOG0642|consen 416 ---SDGTVRLWEPTEESPCTFGEPKEHGYPLSVDRTSSRPAHSLASFRFGYTSIDDMEVVSDLLIFESSASPGPRRYPQI 492 (577)
T ss_pred ---CCceEEeeccCCcCccccCCccccCCcceEeeccchhHhhhhhcccccccchhhhhhhheeeccccCCCcccccCcc
Confidence 689999999876655 11122234567777765553333 3345555555544443333 221111 112
Q ss_pred EEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEE
Q 020784 220 CAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEE 297 (321)
Q Consensus 220 ~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~ 297 (321)
..+-.++.+.+.. ++..|+.|+++|..++. +....+|...|+++++.|+|.+|++++.||. |++|.+....|+...
T Consensus 493 n~vVs~~~~~~~~-~~hed~~Ir~~dn~~~~~l~s~~a~~~svtslai~~ng~~l~s~s~d~s-v~l~kld~k~~~~es 569 (577)
T KOG0642|consen 493 NKVVSHPTADITF-TAHEDRSIRFFDNKTGKILHSMVAHKDSVTSLAIDPNGPYLMSGSHDGS-VRLWKLDVKTCVLES 569 (577)
T ss_pred ceEEecCCCCeeE-ecccCCceecccccccccchheeeccceecceeecCCCceEEeecCCce-eehhhccchheeecc
Confidence 2222333444444 58999999998776654 6788999999999999999999999999999 999999887777654
No 164
>KOG2919 consensus Guanine nucleotide-binding protein [General function prediction only]
Probab=99.50 E-value=2.8e-12 Score=111.28 Aligned_cols=223 Identities=11% Similarity=0.090 Sum_probs=147.9
Q ss_pred CCeEEEEEcCCCCEEEEEcC-CcEEEEEecCC------------ceeEEeeeecCCceEEEEEe-------cCCCeEEEE
Q 020784 86 PTLLHISFNQDHGCFAAGTD-HGFRIYNCDPF------------REIFRRDFERGGGIGVVEML-------FRCNILALV 145 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~------------~~~~~~~~~~~~~v~~v~~~-------~~~~~~~~~ 145 (321)
+-...+.|+|||..|.+-+. +++++|++... +......+..+..|...+|- ++.+++++.
T Consensus 50 nf~kgckWSPDGSciL~~sedn~l~~~nlP~dlys~~~~~~~~~~~~~~~r~~eg~tvydy~wYs~M~s~qP~t~l~a~s 129 (406)
T KOG2919|consen 50 NFLKGCKWSPDGSCILSLSEDNCLNCWNLPFDLYSKKADGPLNFSKHLSYRYQEGETVYDYCWYSRMKSDQPSTNLFAVS 129 (406)
T ss_pred hhhccceeCCCCceEEeecccCeeeEEecChhhcccCCCCccccccceeEEeccCCEEEEEEeeeccccCCCccceeeec
Confidence 45667999999999998887 66889987321 11111111124455555553 456677766
Q ss_pred eCCCCCCCCCCcEEEEeCCCCcEEEEEe---eCC---ceeEEEEeCCe--EEEEECCEEEEEEc-CCcEEEE---EEec-
Q 020784 146 GGGPDPQYPLNKVMIWDDHQSRCIGELS---FRS---EVRSVKLRRDR--IIVVLEQKIFVYNF-ADLKLLH---QIET- 212 (321)
Q Consensus 146 sg~~~~~~~d~~v~iWD~~~~~~~~~~~---~~~---~v~~v~~~~~~--~~~~~~~~I~iwd~-~~~~~~~---~l~~- 212 (321)
+ .+.-|++||.-+|+....+. +-. .-.+++|+++. ++++....||+||+ +.+..-. ++..
T Consensus 130 s-------r~~PIh~wdaftG~lraSy~~ydh~de~taAhsL~Fs~DGeqlfaGykrcirvFdt~RpGr~c~vy~t~~~~ 202 (406)
T KOG2919|consen 130 S-------RDQPIHLWDAFTGKLRASYRAYDHQDEYTAAHSLQFSPDGEQLFAGYKRCIRVFDTSRPGRDCPVYTTVTKG 202 (406)
T ss_pred c-------ccCceeeeeccccccccchhhhhhHHhhhhheeEEecCCCCeEeecccceEEEeeccCCCCCCcchhhhhcc
Confidence 6 67999999999998765543 222 24578898875 55555679999999 4443211 1111
Q ss_pred c---CCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCC-cceEEeeccccceeEEEECCCCCEEEEEeC-CCcEEEEEE
Q 020784 213 I---ANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYAS-KRTKFIMAHDSRIACFALTQDGQLLATSST-KGTLVRIFN 287 (321)
Q Consensus 213 ~---~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~-~~~~~l~~H~~~V~~vafspdg~~las~S~-Dgt~IrIWd 287 (321)
. ...+.+.+++|.. -..+|+ |+....+-|+.... +++..+-+|.+.|+.+.|.++|..|.+|+. |.. |-.||
T Consensus 203 k~gq~giisc~a~sP~~-~~~~a~-gsY~q~~giy~~~~~~pl~llggh~gGvThL~~~edGn~lfsGaRk~dk-Il~WD 279 (406)
T KOG2919|consen 203 KFGQKGIISCFAFSPMD-SKTLAV-GSYGQRVGIYNDDGRRPLQLLGGHGGGVTHLQWCEDGNKLFSGARKDDK-ILCWD 279 (406)
T ss_pred cccccceeeeeeccCCC-Ccceee-ecccceeeeEecCCCCceeeecccCCCeeeEEeccCcCeecccccCCCe-EEEEe
Confidence 1 1223345556543 246675 99999999955444 557788899999999999999999999987 555 99999
Q ss_pred cCC-CcEEEEEeCC--CcceeEEE--eecCceEEEe
Q 020784 288 TLD-GTLLQEECCP--SISAQSGL--WLSSAWLRVL 318 (321)
Q Consensus 288 ~~t-g~~i~~~~~g--~~~~~~~~--s~d~~~la~~ 318 (321)
++. +..+..+.+. ..+.++.| .++|++||.-
T Consensus 280 iR~~~~pv~~L~rhv~~TNQRI~FDld~~~~~LasG 315 (406)
T KOG2919|consen 280 IRYSRDPVYALERHVGDTNQRILFDLDPKGEILASG 315 (406)
T ss_pred ehhccchhhhhhhhccCccceEEEecCCCCceeecc
Confidence 985 4556665433 23455544 4777998864
No 165
>KOG1538 consensus Uncharacterized conserved protein WDR10, contains WD40 repeats [General function prediction only]
Probab=99.49 E-value=9.8e-13 Score=123.38 Aligned_cols=215 Identities=10% Similarity=0.110 Sum_probs=162.2
Q ss_pred CeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCC
Q 020784 87 TLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQS 166 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~ 166 (321)
.|..++|-|||..|+.+.++.+.|||...+........ |...|.+|+++.++..++..+ .|+.|.||.-+-.
T Consensus 14 ci~d~afkPDGsqL~lAAg~rlliyD~ndG~llqtLKg-HKDtVycVAys~dGkrFASG~-------aDK~VI~W~~klE 85 (1081)
T KOG1538|consen 14 CINDIAFKPDGTQLILAAGSRLLVYDTSDGTLLQPLKG-HKDTVYCVAYAKDGKRFASGS-------ADKSVIIWTSKLE 85 (1081)
T ss_pred chheeEECCCCceEEEecCCEEEEEeCCCccccccccc-ccceEEEEEEccCCceeccCC-------CceeEEEeccccc
Confidence 79999999999999988888899999998887766665 788999999999999887666 6899999986532
Q ss_pred cEEEEEeeCCceeEEEEeC--CeEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEE
Q 020784 167 RCIGELSFRSEVRSVKLRR--DRIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVE 244 (321)
Q Consensus 167 ~~~~~~~~~~~v~~v~~~~--~~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~ 244 (321)
.. ....+...|.++.|+| ..++.|+=+..-+|...+... . -+.....+++.++..||++++. |-.||+|.|-
T Consensus 86 G~-LkYSH~D~IQCMsFNP~~h~LasCsLsdFglWS~~qK~V-~---K~kss~R~~~CsWtnDGqylal-G~~nGTIsiR 159 (1081)
T KOG1538|consen 86 GI-LKYSHNDAIQCMSFNPITHQLASCSLSDFGLWSPEQKSV-S---KHKSSSRIICCSWTNDGQYLAL-GMFNGTISIR 159 (1081)
T ss_pred ce-eeeccCCeeeEeecCchHHHhhhcchhhccccChhhhhH-H---hhhhheeEEEeeecCCCcEEEE-eccCceEEee
Confidence 22 2345566788999987 356666656778888764322 1 2223456778888889999996 9999999997
Q ss_pred eeCCcceEEe---eccccceeEEEECCCC-----CEEEEEeCCCcEEEEEEcCCCcEEE-EEeCCCcceeEEEeecCceE
Q 020784 245 HYASKRTKFI---MAHDSRIACFALTQDG-----QLLATSSTKGTLVRIFNTLDGTLLQ-EECCPSISAQSGLWLSSAWL 315 (321)
Q Consensus 245 d~~~~~~~~l---~~H~~~V~~vafspdg-----~~las~S~Dgt~IrIWd~~tg~~i~-~~~~g~~~~~~~~s~d~~~l 315 (321)
+....+...+ -+-+++|.+|+|+|+. ..++...+..| +..+.+ +|+.+. .-.-+.+...+++.++|.|+
T Consensus 160 Nk~gEek~~I~Rpgg~Nspiwsi~~~p~sg~G~~di~aV~DW~qT-LSFy~L-sG~~Igk~r~L~FdP~CisYf~NGEy~ 237 (1081)
T KOG1538|consen 160 NKNGEEKVKIERPGGSNSPIWSICWNPSSGEGRNDILAVADWGQT-LSFYQL-SGKQIGKDRALNFDPCCISYFTNGEYI 237 (1081)
T ss_pred cCCCCcceEEeCCCCCCCCceEEEecCCCCCCccceEEEEeccce-eEEEEe-cceeecccccCCCCchhheeccCCcEE
Confidence 6544433222 2478899999999873 47888888888 765554 566665 44456778888999999998
Q ss_pred EE
Q 020784 316 RV 317 (321)
Q Consensus 316 a~ 317 (321)
.+
T Consensus 238 Li 239 (1081)
T KOG1538|consen 238 LL 239 (1081)
T ss_pred EE
Confidence 65
No 166
>KOG0650 consensus WD40 repeat nucleolar protein Bop1, involved in ribosome biogenesis [Translation, ribosomal structure and biogenesis]
Probab=99.49 E-value=2.2e-13 Score=126.19 Aligned_cols=192 Identities=14% Similarity=0.151 Sum_probs=145.0
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcC----CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCc
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTD----HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNK 157 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~----~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~ 157 (321)
-.|..+|+.+.|+.+|+|||+..- +.|.|..+...+...-... ..+.+..+.+++....+++++ .+.
T Consensus 518 I~~~k~i~~vtWHrkGDYlatV~~~~~~~~VliHQLSK~~sQ~PF~k-skG~vq~v~FHPs~p~lfVaT--------q~~ 588 (733)
T KOG0650|consen 518 IKHPKSIRQVTWHRKGDYLATVMPDSGNKSVLIHQLSKRKSQSPFRK-SKGLVQRVKFHPSKPYLFVAT--------QRS 588 (733)
T ss_pred EecCCccceeeeecCCceEEEeccCCCcceEEEEecccccccCchhh-cCCceeEEEecCCCceEEEEe--------ccc
Confidence 346669999999999999997654 4577888765443211111 267788889988888887776 478
Q ss_pred EEEEeCCCCcEEEEEe-eCCceeEEEEeC--CeEEEEE-CCEEEEEEcC-CcEEEEEEeccCCCCceEEEeeCCCceEEE
Q 020784 158 VMIWDDHQSRCIGELS-FRSEVRSVKLRR--DRIIVVL-EQKIFVYNFA-DLKLLHQIETIANPKGLCAVSQGVGSLVLV 232 (321)
Q Consensus 158 v~iWD~~~~~~~~~~~-~~~~v~~v~~~~--~~~~~~~-~~~I~iwd~~-~~~~~~~l~~~~~~~~~~~~s~~~d~~~la 232 (321)
|+|||+..+..+..+. +...|..+++|+ +.+++++ +++++.||+. ..+..+++..|...+..++++..- .++|
T Consensus 589 vRiYdL~kqelvKkL~tg~kwiS~msihp~GDnli~gs~d~k~~WfDldlsskPyk~lr~H~~avr~Va~H~ry--PLfa 666 (733)
T KOG0650|consen 589 VRIYDLSKQELVKKLLTGSKWISSMSIHPNGDNLILGSYDKKMCWFDLDLSSKPYKTLRLHEKAVRSVAFHKRY--PLFA 666 (733)
T ss_pred eEEEehhHHHHHHHHhcCCeeeeeeeecCCCCeEEEecCCCeeEEEEcccCcchhHHhhhhhhhhhhhhhcccc--ceee
Confidence 9999998877665543 444677888887 6666664 6799999994 456777888887777777777654 7777
Q ss_pred eecCCCCcEEEE-e-----eCCc----ceEEeeccccc----eeEEEECCCCCEEEEEeCCCcEEEEE
Q 020784 233 CPGLQKGQVRVE-H-----YASK----RTKFIMAHDSR----IACFALTQDGQLLATSSTKGTLVRIF 286 (321)
Q Consensus 233 ~sGs~dg~V~i~-d-----~~~~----~~~~l~~H~~~----V~~vafspdg~~las~S~Dgt~IrIW 286 (321)
+|+.||++.|+ . +... +++.|++|... |..+.|+|...+|.|++.||+ ||+|
T Consensus 667 -s~sdDgtv~Vfhg~VY~Dl~qnpliVPlK~L~gH~~~~~~gVLd~~wHP~qpWLfsAGAd~t-irlf 732 (733)
T KOG0650|consen 667 -SGSDDGTVIVFHGMVYNDLLQNPLIVPLKRLRGHEKTNDLGVLDTIWHPRQPWLFSAGADGT-IRLF 732 (733)
T ss_pred -eecCCCcEEEEeeeeehhhhcCCceEeeeeccCceeecccceEeecccCCCceEEecCCCce-EEee
Confidence 69999999983 2 2122 34578999876 999999999999999999999 9998
No 167
>KOG1963 consensus WD40 repeat protein [General function prediction only]
Probab=99.49 E-value=5.3e-12 Score=121.74 Aligned_cols=213 Identities=14% Similarity=0.136 Sum_probs=146.6
Q ss_pred EEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCC---eEEEEeCCCCCCCCCCcEEEEeCCCCc
Q 020784 91 ISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCN---ILALVGGGPDPQYPLNKVMIWDDHQSR 167 (321)
Q Consensus 91 v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~---~~~~~sg~~~~~~~d~~v~iWD~~~~~ 167 (321)
-.|++|++++.....+.|.||...++.++...+. |...+..+.+.+... ++.+++ .+|+|++||...+.
T Consensus 22 avfSnD~k~l~~~~~~~V~VyS~~Tg~~i~~l~~-~~a~l~s~~~~~~~~~~~~~~~~s-------l~G~I~vwd~~~~~ 93 (792)
T KOG1963|consen 22 AVFSNDAKFLFLCTGNFVKVYSTATGECITSLED-HTAPLTSVIVLPSSENANYLIVCS-------LDGTIRVWDWSDGE 93 (792)
T ss_pred cccccCCcEEEEeeCCEEEEEecchHhhhhhccc-ccCccceeeecCCCccceEEEEEe-------cCccEEEecCCCcE
Confidence 3599999999999999999999999988765554 556666666655443 444555 68999999999988
Q ss_pred EEEEEeeCCceeEEEEe------------------------CC-------------------------------------
Q 020784 168 CIGELSFRSEVRSVKLR------------------------RD------------------------------------- 186 (321)
Q Consensus 168 ~~~~~~~~~~v~~v~~~------------------------~~------------------------------------- 186 (321)
.+.++..+.++..+.+. .+
T Consensus 94 Llkt~~~~~~v~~~~~~~~~a~~s~~~~~s~~~~~~~~~~s~~~~~q~~~~~~~t~~~~~~d~~~~~~~~~~I~~~~~ge 173 (792)
T KOG1963|consen 94 LLKTFDNNLPVHALVYKPAQADISANVYVSVEDYSILTTFSKKLSKQSSRFVLATFDSAKGDFLKEHQEPKSIVDNNSGE 173 (792)
T ss_pred EEEEEecCCceeEEEechhHhCccceeEeecccceeeeecccccccceeeeEeeeccccchhhhhhhcCCccEEEcCCce
Confidence 88776543332221110 00
Q ss_pred eEEEEECCEEEEEEcCCcEEEEEEe-----ccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCC-----cceEEeec
Q 020784 187 RIIVVLEQKIFVYNFADLKLLHQIE-----TIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYAS-----KRTKFIMA 256 (321)
Q Consensus 187 ~~~~~~~~~I~iwd~~~~~~~~~l~-----~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~-----~~~~~l~~ 256 (321)
...++....+.+|+..+.. .+... .|.-...+.+++ +.+.++| +|..||.|.+|.--. .....+.=
T Consensus 174 ~~~i~~~~~~~~~~v~~~~-~~~~~~~~~~~Htf~~t~~~~s--pn~~~~A-a~d~dGrI~vw~d~~~~~~~~t~t~lHW 249 (792)
T KOG1963|consen 174 FKGIVHMCKIHIYFVPKHT-KHTSSRDITVHHTFNITCVALS--PNERYLA-AGDSDGRILVWRDFGSSDDSETCTLLHW 249 (792)
T ss_pred EEEEEEeeeEEEEEecccc-eeeccchhhhhhcccceeEEec--cccceEE-EeccCCcEEEEeccccccccccceEEEe
Confidence 2333445677888876543 11110 121122344444 4558888 599999999986332 22456777
Q ss_pred cccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEE--eCCCcceeEEEeecCceEEEe
Q 020784 257 HDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEE--CCPSISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 257 H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~--~~g~~~~~~~~s~d~~~la~~ 318 (321)
|...|++++|+++|.+|.||+..|- +-+|.+.|++ ++| +-|.....+.+|+||.+-++.
T Consensus 250 H~~~V~~L~fS~~G~~LlSGG~E~V-Lv~Wq~~T~~--kqfLPRLgs~I~~i~vS~ds~~~sl~ 310 (792)
T KOG1963|consen 250 HHDEVNSLSFSSDGAYLLSGGREGV-LVLWQLETGK--KQFLPRLGSPILHIVVSPDSDLYSLV 310 (792)
T ss_pred cccccceeEEecCCceEeecccceE-EEEEeecCCC--cccccccCCeeEEEEEcCCCCeEEEE
Confidence 9999999999999999999999999 7799999998 333 344555556788999887664
No 168
>KOG1063 consensus RNA polymerase II elongator complex, subunit ELP2, WD repeat superfamily [Chromatin structure and dynamics; Transcription]
Probab=99.48 E-value=3.3e-12 Score=120.28 Aligned_cols=213 Identities=13% Similarity=0.156 Sum_probs=139.7
Q ss_pred CCcccCCCCCCeEEEEEcCCCC---EEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCC
Q 020784 77 AESTSSSPPPTLLHISFNQDHG---CFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQ 152 (321)
Q Consensus 77 ~~~~~~~~~~~V~~v~fs~dg~---~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~ 152 (321)
......+|.++|+|+.|-|+.+ ++++|+.|+ |++|.+..........+. .+.+.++++.-.........
T Consensus 46 i~t~l~GH~a~VnC~~~l~~s~~~a~~vsG~sD~~v~lW~l~~~~~~~i~~~~-g~~~~~~cv~a~~~~~~~~~------ 118 (764)
T KOG1063|consen 46 IVTTLDGHVARVNCVHWLPTSEIVAEMVSGDSDGRVILWKLRDEYLIKIYTIQ-GHCKECVCVVARSSVMTCKA------ 118 (764)
T ss_pred eEEeccCCccceEEEEEcccccccceEEEccCCCcEEEEEEeehheEEEEeec-CcceeEEEEEeeeeEEEeec------
Confidence 3444578999999999999888 778887765 889999844444444442 23455555543332222222
Q ss_pred CCCCcEEEEeCCCCc--EEEEEeeCC-ce--eEEEE--eCCeEEEEEC---CEEEEEEcC--CcEEEEEEeccCCCCceE
Q 020784 153 YPLNKVMIWDDHQSR--CIGELSFRS-EV--RSVKL--RRDRIIVVLE---QKIFVYNFA--DLKLLHQIETIANPKGLC 220 (321)
Q Consensus 153 ~~d~~v~iWD~~~~~--~~~~~~~~~-~v--~~v~~--~~~~~~~~~~---~~I~iwd~~--~~~~~~~l~~~~~~~~~~ 220 (321)
.|+++.+||.+..+ +...+.+.- .+ .+++. +++.++.+.+ ..|.+|.-. +.+.+..+.+|..++..+
T Consensus 119 -ad~~v~vw~~~~~e~~~~~~~rf~~k~~ipLcL~~~~~~~~~lla~Ggs~~~v~~~s~~~d~f~~v~el~GH~DWIrsl 197 (764)
T KOG1063|consen 119 -ADGTVSVWDKQQDEVFLLAVLRFEIKEAIPLCLAALKNNKTFLLACGGSKFVVDLYSSSADSFARVAELEGHTDWIRSL 197 (764)
T ss_pred -cCceEEEeecCCCceeeehheehhhhhHhhHHHhhhccCCcEEEEecCcceEEEEeccCCcceeEEEEeeccchhhhhh
Confidence 57999999996555 333333321 22 23332 3444444433 256666543 456778889999999988
Q ss_pred EEeeCCCceEEEeecCCCCcEEEEeeCCcc----------------------e----------EEeeccccceeEEEECC
Q 020784 221 AVSQGVGSLVLVCPGLQKGQVRVEHYASKR----------------------T----------KFIMAHDSRIACFALTQ 268 (321)
Q Consensus 221 ~~s~~~d~~~la~sGs~dg~V~i~d~~~~~----------------------~----------~~l~~H~~~V~~vafsp 268 (321)
+|...+.+.++++||+.|..||||.+.... + ..+.||.+.|+++-|+|
T Consensus 198 ~f~~~~~~~~~laS~SQD~yIRiW~i~~~~~~~~~~~e~~~t~~~~~~~f~~l~~i~~~is~eall~GHeDWV~sv~W~p 277 (764)
T KOG1063|consen 198 AFARLGGDDLLLASSSQDRYIRIWRIVLGDDEDSNEREDSLTTLSNLPVFMILEEIQYRISFEALLMGHEDWVYSVWWHP 277 (764)
T ss_pred hhhccCCCcEEEEecCCceEEEEEEEEecCCccccccccccccccCCceeeeeeeEEEEEehhhhhcCcccceEEEEEcc
Confidence 887665545555589999999999753110 1 12459999999999999
Q ss_pred CCCEEEEEeCCCcEEEEEEcC--CCcEEEEEe
Q 020784 269 DGQLLATSSTKGTLVRIFNTL--DGTLLQEEC 298 (321)
Q Consensus 269 dg~~las~S~Dgt~IrIWd~~--tg~~i~~~~ 298 (321)
.+..|.|+|.|.+ +-||.-. +|-=+...+
T Consensus 278 ~~~~LLSASaDks-miiW~pd~~tGiWv~~vR 308 (764)
T KOG1063|consen 278 EGLDLLSASADKS-MIIWKPDENTGIWVDVVR 308 (764)
T ss_pred chhhheecccCcc-eEEEecCCccceEEEEEE
Confidence 9988999999999 7799654 444333443
No 169
>COG2319 FOG: WD40 repeat [General function prediction only]
Probab=99.48 E-value=1.2e-10 Score=106.70 Aligned_cols=205 Identities=19% Similarity=0.283 Sum_probs=151.0
Q ss_pred CeEEEEE-cCCCC-EEEEEcC-C-cEEEEEecC-CceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 87 TLLHISF-NQDHG-CFAAGTD-H-GFRIYNCDP-FREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 87 ~V~~v~f-s~dg~-~lasg~~-~-gv~vw~~~~-~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
.+..+.+ ++++. +++..+. + .+.+|+... ......... |...+..+.+.+++..++..+. .++.+++|
T Consensus 111 ~~~~~~~~~~~~~~~~~~~~~~d~~~~~~~~~~~~~~~~~~~~-~~~~v~~~~~~~~~~~~~~~~~------~~~~~~~~ 183 (466)
T COG2319 111 SVSKLALSSPDGNSILLASSSLDGTVKLWDLSTPGKLIRTLEG-HSESVTSLAFSPDGKLLASGSS------LDGTIKLW 183 (466)
T ss_pred ceeeEEEECCCcceEEeccCCCCccEEEEEecCCCeEEEEEec-CcccEEEEEECCCCCEEEecCC------CCCceEEE
Confidence 5777777 88888 5554343 4 477999987 444444443 6778888888888875555431 27999999
Q ss_pred eCCCCcEEEEEee-CCceeEEEEeCCe--EEEE--ECCEEEEEEcCCcEEEE-EEeccCCCCceEEEeeCCCceEEEeec
Q 020784 162 DDHQSRCIGELSF-RSEVRSVKLRRDR--IIVV--LEQKIFVYNFADLKLLH-QIETIANPKGLCAVSQGVGSLVLVCPG 235 (321)
Q Consensus 162 D~~~~~~~~~~~~-~~~v~~v~~~~~~--~~~~--~~~~I~iwd~~~~~~~~-~l~~~~~~~~~~~~s~~~d~~~la~sG 235 (321)
+...+..+..+.. ...|.++.+.++. +++. .++.|++||...++.+. .+..|.... ...+++++ .+++ ++
T Consensus 184 ~~~~~~~~~~~~~~~~~v~~~~~~~~~~~~~~~~~~d~~i~~wd~~~~~~~~~~~~~~~~~~-~~~~~~~~--~~~~-~~ 259 (466)
T COG2319 184 DLRTGKPLSTLAGHTDPVSSLAFSPDGGLLIASGSSDGTIRLWDLSTGKLLRSTLSGHSDSV-VSSFSPDG--SLLA-SG 259 (466)
T ss_pred EcCCCceEEeeccCCCceEEEEEcCCcceEEEEecCCCcEEEEECCCCcEEeeecCCCCcce-eEeECCCC--CEEE-Ee
Confidence 9998777777765 4579999998765 3333 34699999998888877 577766554 44565554 5555 58
Q ss_pred CCCCcEEEEeeCCcc--eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEe-CCCcc
Q 020784 236 LQKGQVRVEHYASKR--TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEEC-CPSIS 303 (321)
Q Consensus 236 s~dg~V~i~d~~~~~--~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~-~g~~~ 303 (321)
+.|+.+++|+..... +..+.+|...|.++.|+|++..+++++.|+. +++||+.++....... .++..
T Consensus 260 ~~d~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~~~~~~~~~~~~~d~~-~~~~~~~~~~~~~~~~~~~~~~ 329 (466)
T COG2319 260 SSDGTIRLWDLRSSSSLLRTLSGHSSSVLSVAFSPDGKLLASGSSDGT-VRLWDLETGKLLSSLTLKGHEG 329 (466)
T ss_pred cCCCcEEEeeecCCCcEEEEEecCCccEEEEEECCCCCEEEEeeCCCc-EEEEEcCCCceEEEeeecccCC
Confidence 999999999987544 3445789999999999999999999999987 9999999988777664 34443
No 170
>PRK01742 tolB translocation protein TolB; Provisional
Probab=99.46 E-value=9.4e-12 Score=117.96 Aligned_cols=198 Identities=13% Similarity=0.058 Sum_probs=127.9
Q ss_pred CCCCCeEEEEEcCCCCEEEEEcC-C---cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcE
Q 020784 83 SPPPTLLHISFNQDHGCFAAGTD-H---GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg~~lasg~~-~---gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
.+...|.+.+|+|||++||..+. + .+.+||+.+++......+ .+......|+++++.++++.. .++.+
T Consensus 201 ~~~~~v~~p~wSPDG~~la~~s~~~~~~~i~i~dl~tg~~~~l~~~--~g~~~~~~wSPDG~~La~~~~------~~g~~ 272 (429)
T PRK01742 201 RSSQPLMSPAWSPDGSKLAYVSFENKKSQLVVHDLRSGARKVVASF--RGHNGAPAFSPDGSRLAFASS------KDGVL 272 (429)
T ss_pred cCCCccccceEcCCCCEEEEEEecCCCcEEEEEeCCCCceEEEecC--CCccCceeECCCCCEEEEEEe------cCCcE
Confidence 34567999999999999997764 2 378999987754333332 334456789999998887753 23555
Q ss_pred EE--EeCCCCcEEEEEeeCCceeEEEEeCCe--EEEEEC--CEEEEEEcC--CcEEEEEEeccCCCCceEEEeeCCCceE
Q 020784 159 MI--WDDHQSRCIGELSFRSEVRSVKLRRDR--IIVVLE--QKIFVYNFA--DLKLLHQIETIANPKGLCAVSQGVGSLV 230 (321)
Q Consensus 159 ~i--WD~~~~~~~~~~~~~~~v~~v~~~~~~--~~~~~~--~~I~iwd~~--~~~~~~~l~~~~~~~~~~~~s~~~d~~~ 230 (321)
.| ||+.++...........+....|+++. ++.+.+ +...||++. .+. ...+ .+.. ....+ .+|+..
T Consensus 273 ~Iy~~d~~~~~~~~lt~~~~~~~~~~wSpDG~~i~f~s~~~g~~~I~~~~~~~~~-~~~l-~~~~--~~~~~--SpDG~~ 346 (429)
T PRK01742 273 NIYVMGANGGTPSQLTSGAGNNTEPSWSPDGQSILFTSDRSGSPQVYRMSASGGG-ASLV-GGRG--YSAQI--SADGKT 346 (429)
T ss_pred EEEEEECCCCCeEeeccCCCCcCCEEECCCCCEEEEEECCCCCceEEEEECCCCC-eEEe-cCCC--CCccC--CCCCCE
Confidence 54 566666654433334467788898864 444443 567777663 332 2223 2222 22334 445577
Q ss_pred EEeecCCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEc--CCCcEEEEEe
Q 020784 231 LVCPGLQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNT--LDGTLLQEEC 298 (321)
Q Consensus 231 la~sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~--~tg~~i~~~~ 298 (321)
+++.+ .++ +.+||+.++....+..+. ...+++|+|||++|+.++.++. +++|++ .+|++++++.
T Consensus 347 ia~~~-~~~-i~~~Dl~~g~~~~lt~~~-~~~~~~~sPdG~~i~~~s~~g~-~~~l~~~~~~G~~~~~l~ 412 (429)
T PRK01742 347 LVMIN-GDN-VVKQDLTSGSTEVLSSTF-LDESPSISPNGIMIIYSSTQGL-GKVLQLVSADGRFKARLP 412 (429)
T ss_pred EEEEc-CCC-EEEEECCCCCeEEecCCC-CCCCceECCCCCEEEEEEcCCC-ceEEEEEECCCCceEEcc
Confidence 76533 354 455888776654443322 3467889999999999999999 889986 4688888885
No 171
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=99.45 E-value=5e-12 Score=105.87 Aligned_cols=154 Identities=9% Similarity=0.113 Sum_probs=105.7
Q ss_pred EEecCCCeEEEEeCCCCCCCCCCcEEEEeCCC---------Cc-E-EEEEeeCCceeEEEEeCCeEEEEECCEEEEEEcC
Q 020784 134 EMLFRCNILALVGGGPDPQYPLNKVMIWDDHQ---------SR-C-IGELSFRSEVRSVKLRRDRIIVVLEQKIFVYNFA 202 (321)
Q Consensus 134 ~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~---------~~-~-~~~~~~~~~v~~v~~~~~~~~~~~~~~I~iwd~~ 202 (321)
++++...+++.+. .+|+|.+..++. ++ . +.+-.++++++.+.|+.+.++++.++.|+=|..+
T Consensus 17 a~sp~~~~l~agn-------~~G~iav~sl~sl~s~sa~~~gk~~iv~eqahdgpiy~~~f~d~~Lls~gdG~V~gw~W~ 89 (325)
T KOG0649|consen 17 AISPSKQYLFAGN-------LFGDIAVLSLKSLDSGSAEPPGKLKIVPEQAHDGPIYYLAFHDDFLLSGGDGLVYGWEWN 89 (325)
T ss_pred hhCCcceEEEEec-------CCCeEEEEEehhhhccccCCCCCcceeeccccCCCeeeeeeehhheeeccCceEEEeeeh
Confidence 4556666655544 568888887543 11 2 2223355689999999999999999999999875
Q ss_pred CcEE------EEEEec--c-----CCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceE-EeeccccceeEEEECC
Q 020784 203 DLKL------LHQIET--I-----ANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTK-FIMAHDSRIACFALTQ 268 (321)
Q Consensus 203 ~~~~------~~~l~~--~-----~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~-~l~~H~~~V~~vafsp 268 (321)
.... +-.++. + ...+..+.+.|..+..++| | .|+.++-||+.++.++ ++++|+.+|.+|+--.
T Consensus 90 E~~es~~~K~lwe~~~P~~~~~~evPeINam~ldP~enSi~~A--g-GD~~~y~~dlE~G~i~r~~rGHtDYvH~vv~R~ 166 (325)
T KOG0649|consen 90 EEEESLATKRLWEVKIPMQVDAVEVPEINAMWLDPSENSILFA--G-GDGVIYQVDLEDGRIQREYRGHTDYVHSVVGRN 166 (325)
T ss_pred hhhhhccchhhhhhcCccccCcccCCccceeEeccCCCcEEEe--c-CCeEEEEEEecCCEEEEEEcCCcceeeeeeecc
Confidence 4322 111111 1 1123444555443333333 4 7888888999998864 8999999999999843
Q ss_pred CCCEEEEEeCCCcEEEEEEcCCCcEEEEEe
Q 020784 269 DGQLLATSSTKGTLVRIFNTLDGTLLQEEC 298 (321)
Q Consensus 269 dg~~las~S~Dgt~IrIWd~~tg~~i~~~~ 298 (321)
....+.||++||+ +||||++++++++.+.
T Consensus 167 ~~~qilsG~EDGt-vRvWd~kt~k~v~~ie 195 (325)
T KOG0649|consen 167 ANGQILSGAEDGT-VRVWDTKTQKHVSMIE 195 (325)
T ss_pred cCcceeecCCCcc-EEEEeccccceeEEec
Confidence 3444679999999 9999999999998764
No 172
>KOG1034 consensus Transcriptional repressor EED/ESC/FIE, required for transcriptional silencing, WD repeat superfamily [Transcription]
Probab=99.45 E-value=7.6e-13 Score=114.90 Aligned_cols=198 Identities=15% Similarity=0.155 Sum_probs=134.9
Q ss_pred CCCCCCeEEEEEcCCC-CEEEEEcCCc-EEEEEecCCceeEEeeee--cCCceEEEEEecCCCeEEEEeCCCCCCCCCCc
Q 020784 82 SSPPPTLLHISFNQDH-GCFAAGTDHG-FRIYNCDPFREIFRRDFE--RGGGIGVVEMLFRCNILALVGGGPDPQYPLNK 157 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg-~~lasg~~~g-v~vw~~~~~~~~~~~~~~--~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~ 157 (321)
++|+..|+.+.|.|+. +++++++.|. ||+||+++..++...-.- |.+.|..++++.++..++.++ .|..
T Consensus 132 ~ghG~sINeik~~p~~~qlvls~SkD~svRlwnI~~~~Cv~VfGG~egHrdeVLSvD~~~~gd~i~ScG-------mDhs 204 (385)
T KOG1034|consen 132 RGHGGSINEIKFHPDRPQLVLSASKDHSVRLWNIQTDVCVAVFGGVEGHRDEVLSVDFSLDGDRIASCG-------MDHS 204 (385)
T ss_pred eccCccchhhhcCCCCCcEEEEecCCceEEEEeccCCeEEEEecccccccCcEEEEEEcCCCCeeeccC-------Ccce
Confidence 6788899999999987 6788888755 999999999876654321 677889999999998777766 7899
Q ss_pred EEEEeCCCCcEEEEEe------------------eCCc-----------eeEEEEeCCeEEE-EECCEEEEEEcCC-cEE
Q 020784 158 VMIWDDHQSRCIGELS------------------FRSE-----------VRSVKLRRDRIIV-VLEQKIFVYNFAD-LKL 206 (321)
Q Consensus 158 v~iWD~~~~~~~~~~~------------------~~~~-----------v~~v~~~~~~~~~-~~~~~I~iwd~~~-~~~ 206 (321)
+++|++...+....++ .+.+ |-++.|-.+.++. ..++.|..|...+ .+.
T Consensus 205 lk~W~l~~~~f~~~lE~s~~~~~~~t~~pfpt~~~~fp~fst~diHrnyVDCvrw~gd~ilSkscenaI~~w~pgkl~e~ 284 (385)
T KOG1034|consen 205 LKLWRLNVKEFKNKLELSITYSPNKTTRPFPTPKTHFPDFSTTDIHRNYVDCVRWFGDFILSKSCENAIVCWKPGKLEES 284 (385)
T ss_pred EEEEecChhHHhhhhhhhcccCCCCccCcCCccccccccccccccccchHHHHHHHhhheeecccCceEEEEecchhhhh
Confidence 9999988443221111 0111 2222222333333 2457999998732 222
Q ss_pred EE-------------EEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcce---EEeecc--ccceeEEEECC
Q 020784 207 LH-------------QIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRT---KFIMAH--DSRIACFALTQ 268 (321)
Q Consensus 207 ~~-------------~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~---~~l~~H--~~~V~~vafsp 268 (321)
++ .++-..-.+-.+.|+.++-+..||+ |...|.|.+||+..... .++..+ ...|+..+||.
T Consensus 285 ~~~vkp~es~~Ti~~~~~~~~c~iWfirf~~d~~~~~la~-gnq~g~v~vwdL~~~ep~~~ttl~~s~~~~tVRQ~sfS~ 363 (385)
T KOG1034|consen 285 IHNVKPPESATTILGEFDYPMCDIWFIRFAFDPWQKMLAL-GNQSGKVYVWDLDNNEPPKCTTLTHSKSGSTVRQTSFSR 363 (385)
T ss_pred hhccCCCccceeeeeEeccCccceEEEEEeecHHHHHHhh-ccCCCcEEEEECCCCCCccCceEEeccccceeeeeeecc
Confidence 22 2222111222456677776778885 99999999999976432 244333 45799999999
Q ss_pred CCCEEEEEeCCCcEEEEEEc
Q 020784 269 DGQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 269 dg~~las~S~Dgt~IrIWd~ 288 (321)
||.+|+-..+|++ |--||.
T Consensus 364 dgs~lv~vcdd~~-Vwrwdr 382 (385)
T KOG1034|consen 364 DGSILVLVCDDGT-VWRWDR 382 (385)
T ss_pred cCcEEEEEeCCCc-EEEEEe
Confidence 9999999999999 766764
No 173
>KOG3881 consensus Uncharacterized conserved protein [Function unknown]
Probab=99.44 E-value=1.1e-11 Score=109.83 Aligned_cols=213 Identities=15% Similarity=0.193 Sum_probs=144.7
Q ss_pred CCCeEEEEEcCCCCEEEEEcCCcEEEEEecCCc----eeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 85 PPTLLHISFNQDHGCFAAGTDHGFRIYNCDPFR----EIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 85 ~~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~----~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
..+|..+.- .||.+++|-+.+.+.+|+.+... ....+.. +..+..+.-+.....++..+|-. +-+.++|
T Consensus 105 ~~~I~gl~~-~dg~Litc~~sG~l~~~~~k~~d~hss~l~~la~--g~g~~~~r~~~~~p~Iva~GGke----~~n~lki 177 (412)
T KOG3881|consen 105 TKSIKGLKL-ADGTLITCVSSGNLQVRHDKSGDLHSSKLIKLAT--GPGLYDVRQTDTDPYIVATGGKE----NINELKI 177 (412)
T ss_pred cccccchhh-cCCEEEEEecCCcEEEEeccCCccccccceeeec--CCceeeeccCCCCCceEecCchh----cccceee
Confidence 345555443 25666666555668899887322 2222222 45666766666555555555443 2378999
Q ss_pred EeCCCCcEEEEEe--------eCCc--eeEEEEeCC----eEEEEEC-CEEEEEEcCCc-EEEEEEeccCCCCceEEEee
Q 020784 161 WDDHQSRCIGELS--------FRSE--VRSVKLRRD----RIIVVLE-QKIFVYNFADL-KLLHQIETIANPKGLCAVSQ 224 (321)
Q Consensus 161 WD~~~~~~~~~~~--------~~~~--v~~v~~~~~----~~~~~~~-~~I~iwd~~~~-~~~~~l~~~~~~~~~~~~s~ 224 (321)
||++..+.+..-+ ...+ ++++.|-+. .++.++. +++|+||.+.+ +.+..|....+++..+..-+
T Consensus 178 wdle~~~qiw~aKNvpnD~L~LrVPvW~tdi~Fl~g~~~~~fat~T~~hqvR~YDt~~qRRPV~~fd~~E~~is~~~l~p 257 (412)
T KOG3881|consen 178 WDLEQSKQIWSAKNVPNDRLGLRVPVWITDIRFLEGSPNYKFATITRYHQVRLYDTRHQRRPVAQFDFLENPISSTGLTP 257 (412)
T ss_pred eecccceeeeeccCCCCccccceeeeeeccceecCCCCCceEEEEecceeEEEecCcccCcceeEeccccCcceeeeecC
Confidence 9998875554321 1222 345666543 4555554 79999999754 56777777666655555554
Q ss_pred CCCceEEEeecCCCCcEEEEeeCCcceE--EeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCc
Q 020784 225 GVGSLVLVCPGLQKGQVRVEHYASKRTK--FIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSI 302 (321)
Q Consensus 225 ~~d~~~la~sGs~dg~V~i~d~~~~~~~--~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~ 302 (321)
+++++. .|...|.+..+|.+.+.+. .+++..+.|++|-.+|.+++||+||-|+. |||+|+.+.++++.......
T Consensus 258 --~gn~Iy-~gn~~g~l~~FD~r~~kl~g~~~kg~tGsirsih~hp~~~~las~GLDRy-vRIhD~ktrkll~kvYvKs~ 333 (412)
T KOG3881|consen 258 --SGNFIY-TGNTKGQLAKFDLRGGKLLGCGLKGITGSIRSIHCHPTHPVLASCGLDRY-VRIHDIKTRKLLHKVYVKSR 333 (412)
T ss_pred --CCcEEE-EecccchhheecccCceeeccccCCccCCcceEEEcCCCceEEeecccee-EEEeecccchhhhhhhhhcc
Confidence 446665 4999999999999887754 58999999999999999999999999999 99999999988887666555
Q ss_pred ceeEEE
Q 020784 303 SAQSGL 308 (321)
Q Consensus 303 ~~~~~~ 308 (321)
...+.+
T Consensus 334 lt~il~ 339 (412)
T KOG3881|consen 334 LTFILL 339 (412)
T ss_pred ccEEEe
Confidence 444433
No 174
>KOG1034 consensus Transcriptional repressor EED/ESC/FIE, required for transcriptional silencing, WD repeat superfamily [Transcription]
Probab=99.44 E-value=6.9e-11 Score=102.88 Aligned_cols=156 Identities=12% Similarity=0.169 Sum_probs=111.2
Q ss_pred CCCCCeEEEEEcC-----CCCEEEEEcCCcEEEEEecCCc--eeEEeeee--cCCceEEEEEecCC---CeEEEEeCCCC
Q 020784 83 SPPPTLLHISFNQ-----DHGCFAAGTDHGFRIYNCDPFR--EIFRRDFE--RGGGIGVVEMLFRC---NILALVGGGPD 150 (321)
Q Consensus 83 ~~~~~V~~v~fs~-----dg~~lasg~~~gv~vw~~~~~~--~~~~~~~~--~~~~v~~v~~~~~~---~~~~~~sg~~~ 150 (321)
.|+.+|..++|++ +-+.+|+.+.+.+.||++.... ..+....+ |+....-++|..+. +-+.+++|
T Consensus 36 d~~~~I~gv~fN~~~~~~e~~vfatvG~~rvtiy~c~~d~~ir~lq~y~D~d~~Esfytcsw~yd~~~~~p~la~~G--- 112 (385)
T KOG1034|consen 36 DHNKPIFGVAFNSFLGCDEPQVFATVGGNRVTIYECPGDGGIRLLQSYADEDHDESFYTCSWSYDSNTGNPFLAAGG--- 112 (385)
T ss_pred cCCCccceeeeehhcCCCCCceEEEeCCcEEEEEEECCccceeeeeeccCCCCCcceEEEEEEecCCCCCeeEEeec---
Confidence 4666899999995 3357888888888999986544 22222111 34456666776543 33434443
Q ss_pred CCCCCCcEEEEeCCCCcEEEEEeeCC-ceeEEEEeCCe--EEE-EE-CCEEEEEEcCCcEEEEEEe---ccCCCCceEEE
Q 020784 151 PQYPLNKVMIWDDHQSRCIGELSFRS-EVRSVKLRRDR--IIV-VL-EQKIFVYNFADLKLLHQIE---TIANPKGLCAV 222 (321)
Q Consensus 151 ~~~~d~~v~iWD~~~~~~~~~~~~~~-~v~~v~~~~~~--~~~-~~-~~~I~iwd~~~~~~~~~l~---~~~~~~~~~~~ 222 (321)
.-|-|||.|+.++++...+..++ .|..+.+++.+ +++ ++ |..||+||++++.++..|. +|...+..++|
T Consensus 113 ---~~GvIrVid~~~~~~~~~~~ghG~sINeik~~p~~~qlvls~SkD~svRlwnI~~~~Cv~VfGG~egHrdeVLSvD~ 189 (385)
T KOG1034|consen 113 ---YLGVIRVIDVVSGQCSKNYRGHGGSINEIKFHPDRPQLVLSASKDHSVRLWNIQTDVCVAVFGGVEGHRDEVLSVDF 189 (385)
T ss_pred ---ceeEEEEEecchhhhccceeccCccchhhhcCCCCCcEEEEecCCceEEEEeccCCeEEEEecccccccCcEEEEEE
Confidence 35999999999999988877665 78899998865 444 43 4599999999999998884 46666666666
Q ss_pred eeCCCceEEEeecCCCCcEEEEeeC
Q 020784 223 SQGVGSLVLVCPGLQKGQVRVEHYA 247 (321)
Q Consensus 223 s~~~d~~~la~sGs~dg~V~i~d~~ 247 (321)
+.++ ..++ |++.|-.+++|++.
T Consensus 190 ~~~g--d~i~-ScGmDhslk~W~l~ 211 (385)
T KOG1034|consen 190 SLDG--DRIA-SCGMDHSLKLWRLN 211 (385)
T ss_pred cCCC--Ceee-ccCCcceEEEEecC
Confidence 6554 5777 68999999999865
No 175
>KOG0321 consensus WD40 repeat-containing protein L2DTL [Function unknown]
Probab=99.43 E-value=6.1e-12 Score=117.53 Aligned_cols=218 Identities=10% Similarity=0.099 Sum_probs=139.2
Q ss_pred ccCCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEee-eecCCceEEEEEecCCCeEEEEeCCCCCCCCCCc
Q 020784 80 TSSSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRD-FERGGGIGVVEMLFRCNILALVGGGPDPQYPLNK 157 (321)
Q Consensus 80 ~~~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~-~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~ 157 (321)
....|.+.|..+.|-|-..+|++++. .++++||++..++...+. +.|.+.+..+++.+....+. +.|+ .||.
T Consensus 95 ~~~aH~nAifDl~wapge~~lVsasGDsT~r~Wdvk~s~l~G~~~~~GH~~SvkS~cf~~~n~~vF-~tGg-----RDg~ 168 (720)
T KOG0321|consen 95 KPLAHKNAIFDLKWAPGESLLVSASGDSTIRPWDVKTSRLVGGRLNLGHTGSVKSECFMPTNPAVF-CTGG-----RDGE 168 (720)
T ss_pred ccccccceeEeeccCCCceeEEEccCCceeeeeeeccceeecceeecccccccchhhhccCCCcce-eecc-----CCCc
Confidence 34568889999999995456776654 679999999887765432 22678888888876544443 3444 5799
Q ss_pred EEEEeCCCCc--EEE--------EEe----------------------eCCceeEEEEeCC-eEEEEE--CCEEEEEEcC
Q 020784 158 VMIWDDHQSR--CIG--------ELS----------------------FRSEVRSVKLRRD-RIIVVL--EQKIFVYNFA 202 (321)
Q Consensus 158 v~iWD~~~~~--~~~--------~~~----------------------~~~~v~~v~~~~~-~~~~~~--~~~I~iwd~~ 202 (321)
|.|||++-.. ... ..+ ..+.|+.+.|..+ .++.++ |+.|++||++
T Consensus 169 illWD~R~n~~d~~e~~~~~~~~~~n~~ptpskp~~kr~~k~kA~s~ti~ssvTvv~fkDe~tlaSaga~D~~iKVWDLR 248 (720)
T KOG0321|consen 169 ILLWDCRCNGVDALEEFDNRIYGRHNTAPTPSKPLKKRIRKWKAASNTIFSSVTVVLFKDESTLASAGAADSTIKVWDLR 248 (720)
T ss_pred EEEEEEeccchhhHHHHhhhhhccccCCCCCCchhhccccccccccCceeeeeEEEEEeccceeeeccCCCcceEEEeec
Confidence 9999975332 000 000 1123445555433 344443 5799999998
Q ss_pred CcEEEEEE--------ecc-CCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc---eEEeeccccc---eeEEEEC
Q 020784 203 DLKLLHQI--------ETI-ANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR---TKFIMAHDSR---IACFALT 267 (321)
Q Consensus 203 ~~~~~~~l--------~~~-~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~---~~~l~~H~~~---V~~vafs 267 (321)
+....... ..+ ...++...+..|..|.+|.+++. |+.|+.|++.... ...+.+|... |.+ ..+
T Consensus 249 k~~~~~r~ep~~~~~~~t~skrs~G~~nL~lDssGt~L~AsCt-D~sIy~ynm~s~s~sP~~~~sg~~~~sf~vks-~lS 326 (720)
T KOG0321|consen 249 KNYTAYRQEPRGSDKYPTHSKRSVGQVNLILDSSGTYLFASCT-DNSIYFYNMRSLSISPVAEFSGKLNSSFYVKS-ELS 326 (720)
T ss_pred ccccccccCCCcccCccCcccceeeeEEEEecCCCCeEEEEec-CCcEEEEeccccCcCchhhccCcccceeeeee-ecC
Confidence 75443322 111 11345677777776777765555 8999999986532 3345555332 222 368
Q ss_pred CCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeE
Q 020784 268 QDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQS 306 (321)
Q Consensus 268 pdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~ 306 (321)
||+.+|++|+.|.. ..||.+.+-+.--.+..||...+.
T Consensus 327 pd~~~l~SgSsd~~-ayiw~vs~~e~~~~~l~Ght~eVt 364 (720)
T KOG0321|consen 327 PDDCSLLSGSSDEQ-AYIWVVSSPEAPPALLLGHTREVT 364 (720)
T ss_pred CCCceEeccCCCcc-eeeeeecCccCChhhhhCcceEEE
Confidence 99999999999999 999999986644334455554443
No 176
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=99.42 E-value=1.6e-10 Score=105.71 Aligned_cols=209 Identities=10% Similarity=0.054 Sum_probs=130.3
Q ss_pred EEEEcCCcEEEEEecCC-ceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC-CCcE--EEEEeeC
Q 020784 100 FAAGTDHGFRIYNCDPF-REIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH-QSRC--IGELSFR 175 (321)
Q Consensus 100 lasg~~~gv~vw~~~~~-~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~-~~~~--~~~~~~~ 175 (321)
++.+.+++|.+|++.+. +......+.+.+....+.++++++.+++++. .++.|.+|+++ ++.. +......
T Consensus 6 ~~~~~~~~I~~~~~~~~g~l~~~~~~~~~~~~~~l~~spd~~~lyv~~~------~~~~i~~~~~~~~g~l~~~~~~~~~ 79 (330)
T PRK11028 6 IASPESQQIHVWNLNHEGALTLLQVVDVPGQVQPMVISPDKRHLYVGVR------PEFRVLSYRIADDGALTFAAESPLP 79 (330)
T ss_pred EEcCCCCCEEEEEECCCCceeeeeEEecCCCCccEEECCCCCEEEEEEC------CCCcEEEEEECCCCceEEeeeecCC
Confidence 33344577999999643 3222232323455667788888988877653 35889999987 3432 2333344
Q ss_pred CceeEEEEeCC--eEEEEE--CCEEEEEEcCC-c---EEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeC
Q 020784 176 SEVRSVKLRRD--RIIVVL--EQKIFVYNFAD-L---KLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYA 247 (321)
Q Consensus 176 ~~v~~v~~~~~--~~~~~~--~~~I~iwd~~~-~---~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~ 247 (321)
..+..+.++++ .++++. ++.|.+|++.+ + +.+..+.....+ ..++++ +++.++.++...++.|.+||+.
T Consensus 80 ~~p~~i~~~~~g~~l~v~~~~~~~v~v~~~~~~g~~~~~~~~~~~~~~~-~~~~~~--p~g~~l~v~~~~~~~v~v~d~~ 156 (330)
T PRK11028 80 GSPTHISTDHQGRFLFSASYNANCVSVSPLDKDGIPVAPIQIIEGLEGC-HSANID--PDNRTLWVPCLKEDRIRLFTLS 156 (330)
T ss_pred CCceEEEECCCCCEEEEEEcCCCeEEEEEECCCCCCCCceeeccCCCcc-cEeEeC--CCCCEEEEeeCCCCEEEEEEEC
Confidence 46777888865 466654 57999999963 3 223333222222 234454 4556665557788999999986
Q ss_pred C-cceEE-----ee-ccccceeEEEECCCCCEEEEEeC-CCcEEEEEEcC--CCc--EEEEEeCC-------CcceeEEE
Q 020784 248 S-KRTKF-----IM-AHDSRIACFALTQDGQLLATSST-KGTLVRIFNTL--DGT--LLQEECCP-------SISAQSGL 308 (321)
Q Consensus 248 ~-~~~~~-----l~-~H~~~V~~vafspdg~~las~S~-Dgt~IrIWd~~--tg~--~i~~~~~g-------~~~~~~~~ 308 (321)
. +.+.. .. .....++.++|+|+|++|.++.+ +++ |.+|++. +++ .+.++... .....+.+
T Consensus 157 ~~g~l~~~~~~~~~~~~g~~p~~~~~~pdg~~lyv~~~~~~~-v~v~~~~~~~~~~~~~~~~~~~p~~~~~~~~~~~i~~ 235 (330)
T PRK11028 157 DDGHLVAQEPAEVTTVEGAGPRHMVFHPNQQYAYCVNELNSS-VDVWQLKDPHGEIECVQTLDMMPADFSDTRWAADIHI 235 (330)
T ss_pred CCCcccccCCCceecCCCCCCceEEECCCCCEEEEEecCCCE-EEEEEEeCCCCCEEEEEEEecCCCcCCCCccceeEEE
Confidence 5 22211 11 12345788999999999988877 777 9999997 343 34544321 01223678
Q ss_pred eecCceEEEe
Q 020784 309 WLSSAWLRVL 318 (321)
Q Consensus 309 s~d~~~la~~ 318 (321)
++|+++|.++
T Consensus 236 ~pdg~~lyv~ 245 (330)
T PRK11028 236 TPDGRHLYAC 245 (330)
T ss_pred CCCCCEEEEe
Confidence 8999999886
No 177
>KOG1188 consensus WD40 repeat protein [General function prediction only]
Probab=99.41 E-value=6.4e-12 Score=109.70 Aligned_cols=190 Identities=14% Similarity=0.127 Sum_probs=131.3
Q ss_pred CEEEEEc-CCcEEEEEecCCceeEEeeeecCCceEEEEEec--CCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEee
Q 020784 98 GCFAAGT-DHGFRIYNCDPFREIFRRDFERGGGIGVVEMLF--RCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSF 174 (321)
Q Consensus 98 ~~lasg~-~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~--~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~ 174 (321)
..+|+|- .+.|++||..+++.+..... +...+..+.+.. .+..+.+++ .||+||+||++.......+..
T Consensus 41 ~~vav~lSngsv~lyd~~tg~~l~~fk~-~~~~~N~vrf~~~ds~h~v~s~s-------sDG~Vr~wD~Rs~~e~a~~~~ 112 (376)
T KOG1188|consen 41 TAVAVSLSNGSVRLYDKGTGQLLEEFKG-PPATTNGVRFISCDSPHGVISCS-------SDGTVRLWDIRSQAESARISW 112 (376)
T ss_pred eeEEEEecCCeEEEEeccchhhhheecC-CCCcccceEEecCCCCCeeEEec-------cCCeEEEEEeecchhhhheec
Confidence 4456554 46699999999766544443 345555666654 455566665 689999999998776555544
Q ss_pred CC----ceeEEEEe-CCeEEEE-EC-----CEEEEEEcCCcEE-EEEE-eccCCCCceEEEeeCCCceEEEeecCCCCcE
Q 020784 175 RS----EVRSVKLR-RDRIIVV-LE-----QKIFVYNFADLKL-LHQI-ETIANPKGLCAVSQGVGSLVLVCPGLQKGQV 241 (321)
Q Consensus 175 ~~----~v~~v~~~-~~~~~~~-~~-----~~I~iwd~~~~~~-~~~l-~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V 241 (321)
.. +..+++.+ ++.++.+ +. -.|.+||++..+. +..+ +.|...+..+.|+|... .+|+ +|+.||-|
T Consensus 113 ~~~~~~~f~~ld~nck~~ii~~GtE~~~s~A~v~lwDvR~~qq~l~~~~eSH~DDVT~lrFHP~~p-nlLl-SGSvDGLv 190 (376)
T KOG1188|consen 113 TQQSGTPFICLDLNCKKNIIACGTELTRSDASVVLWDVRSEQQLLRQLNESHNDDVTQLRFHPSDP-NLLL-SGSVDGLV 190 (376)
T ss_pred cCCCCCcceEeeccCcCCeEEeccccccCceEEEEEEeccccchhhhhhhhccCcceeEEecCCCC-CeEE-eecccceE
Confidence 32 34556654 3344443 32 3899999987655 5554 56778888888887643 4555 79999999
Q ss_pred EEEeeCCc----ceEEeeccccceeEEEECCCC-CEEEEEeCCCcEEEEEEcCCCcEEEEEe
Q 020784 242 RVEHYASK----RTKFIMAHDSRIACFALTQDG-QLLATSSTKGTLVRIFNTLDGTLLQEEC 298 (321)
Q Consensus 242 ~i~d~~~~----~~~~l~~H~~~V~~vafspdg-~~las~S~Dgt~IrIWd~~tg~~i~~~~ 298 (321)
.++|.+.. .+...-.|.+.|.++.|..++ +.+.+-+...+ ..+|+++.|.+...+.
T Consensus 191 nlfD~~~d~EeDaL~~viN~~sSI~~igw~~~~ykrI~clTH~Et-f~~~ele~~~~~~~~~ 251 (376)
T KOG1188|consen 191 NLFDTKKDNEEDALLHVINHGSSIHLIGWLSKKYKRIMCLTHMET-FAIYELEDGSEETWLE 251 (376)
T ss_pred EeeecCCCcchhhHHHhhcccceeeeeeeecCCcceEEEEEccCc-eeEEEccCCChhhccc
Confidence 99998643 233344578889999999776 45777888999 9999999988655443
No 178
>KOG0771 consensus Prolactin regulatory element-binding protein/Protein transport protein SEC12p [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.40 E-value=5.4e-12 Score=112.81 Aligned_cols=179 Identities=18% Similarity=0.206 Sum_probs=131.2
Q ss_pred EEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC-CCcEEEEEeeCCceeEEEEeCCeEEE--EECCEEEEEEcCCcEEE
Q 020784 131 GVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH-QSRCIGELSFRSEVRSVKLRRDRIIV--VLEQKIFVYNFADLKLL 207 (321)
Q Consensus 131 ~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~-~~~~~~~~~~~~~v~~v~~~~~~~~~--~~~~~I~iwd~~~~~~~ 207 (321)
.++++.+++..+++.+ .||++|||+.- ......+..++.+|.++.|+++...+ .+.+..+||+.+++..+
T Consensus 148 k~vaf~~~gs~latgg-------~dg~lRv~~~Ps~~t~l~e~~~~~eV~DL~FS~dgk~lasig~d~~~VW~~~~g~~~ 220 (398)
T KOG0771|consen 148 KVVAFNGDGSKLATGG-------TDGTLRVWEWPSMLTILEEIAHHAEVKDLDFSPDGKFLASIGADSARVWSVNTGAAL 220 (398)
T ss_pred eEEEEcCCCCEeeecc-------ccceEEEEecCcchhhhhhHhhcCccccceeCCCCcEEEEecCCceEEEEeccCchh
Confidence 6778888888888877 78999999954 44455566788899999999986333 34569999999999777
Q ss_pred EEEeccCC--CCceEEEeeCCC--ceEEEeecCCCCcEEEEeeCC--c----ceEEeeccccceeEEEECCCCCEEEEEe
Q 020784 208 HQIETIAN--PKGLCAVSQGVG--SLVLVCPGLQKGQVRVEHYAS--K----RTKFIMAHDSRIACFALTQDGQLLATSS 277 (321)
Q Consensus 208 ~~l~~~~~--~~~~~~~s~~~d--~~~la~sGs~dg~V~i~d~~~--~----~~~~l~~H~~~V~~vafspdg~~las~S 277 (321)
........ ....|.|+.+++ ..+++++-...|.|+.++... + +......-...|++++.|.||+++|-|+
T Consensus 221 a~~t~~~k~~~~~~cRF~~d~~~~~l~laa~~~~~~~v~~~~~~~w~~~~~l~~~~~~~~~~siSsl~VS~dGkf~AlGT 300 (398)
T KOG0771|consen 221 ARKTPFSKDEMFSSCRFSVDNAQETLRLAASQFPGGGVRLCDISLWSGSNFLRLRKKIKRFKSISSLAVSDDGKFLALGT 300 (398)
T ss_pred hhcCCcccchhhhhceecccCCCceEEEEEecCCCCceeEEEeeeeccccccchhhhhhccCcceeEEEcCCCcEEEEec
Confidence 66653222 234677776653 345554455556676655432 1 1112222345699999999999999999
Q ss_pred CCCcEEEEEEcCCCcEEEEEeCCCccee--EEEeecCceEEE
Q 020784 278 TKGTLVRIFNTLDGTLLQEECCPSISAQ--SGLWLSSAWLRV 317 (321)
Q Consensus 278 ~Dgt~IrIWd~~tg~~i~~~~~g~~~~~--~~~s~d~~~la~ 317 (321)
.||. |-|++..+.++++-.++.|...+ +.|++|.++++-
T Consensus 301 ~dGs-Vai~~~~~lq~~~~vk~aH~~~VT~ltF~Pdsr~~~s 341 (398)
T KOG0771|consen 301 MDGS-VAIYDAKSLQRLQYVKEAHLGFVTGLTFSPDSRYLAS 341 (398)
T ss_pred cCCc-EEEEEeceeeeeEeehhhheeeeeeEEEcCCcCcccc
Confidence 9999 99999999999998888888655 488899988764
No 179
>KOG1063 consensus RNA polymerase II elongator complex, subunit ELP2, WD repeat superfamily [Chromatin structure and dynamics; Transcription]
Probab=99.40 E-value=8.9e-12 Score=117.42 Aligned_cols=200 Identities=15% Similarity=0.106 Sum_probs=138.8
Q ss_pred ccCCCCCCeEEEEEcCCCCEEEEEcC------CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCC
Q 020784 80 TSSSPPPTLLHISFNQDHGCFAAGTD------HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQY 153 (321)
Q Consensus 80 ~~~~~~~~V~~v~fs~dg~~lasg~~------~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~ 153 (321)
+.++|...|+|++.+|+|+++|++.. -.|+||+..+=.......+ |.=.|..+++++++.+++.++
T Consensus 520 KLYGHGyEv~~l~~s~~gnliASaCKS~~~ehAvI~lw~t~~W~~~~~L~~-HsLTVT~l~FSpdg~~LLsvs------- 591 (764)
T KOG1063|consen 520 KLYGHGYEVYALAISPTGNLIASACKSSLKEHAVIRLWNTANWLQVQELEG-HSLTVTRLAFSPDGRYLLSVS------- 591 (764)
T ss_pred HhccCceeEEEEEecCCCCEEeehhhhCCccceEEEEEeccchhhhheecc-cceEEEEEEECCCCcEEEEee-------
Confidence 34789999999999999999998864 1377999877665555555 566788899999999999998
Q ss_pred CCCcEEEEeCCCCcE-EEE---Ee-eCCceeEEEEeCCeE--EEEE-CCEEEEEEcCCc--EEEEEEec--cCCCCceEE
Q 020784 154 PLNKVMIWDDHQSRC-IGE---LS-FRSEVRSVKLRRDRI--IVVL-EQKIFVYNFADL--KLLHQIET--IANPKGLCA 221 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~-~~~---~~-~~~~v~~v~~~~~~~--~~~~-~~~I~iwd~~~~--~~~~~l~~--~~~~~~~~~ 221 (321)
.|+++.+|...+... -.. .+ +...|.+..|+++.. +.++ |++|++|...+. +.+..+.. +...+..++
T Consensus 592 RDRt~sl~~~~~~~~~e~~fa~~k~HtRIIWdcsW~pde~~FaTaSRDK~VkVW~~~~~~d~~i~~~a~~~~~~aVTAv~ 671 (764)
T KOG1063|consen 592 RDRTVSLYEVQEDIKDEFRFACLKAHTRIIWDCSWSPDEKYFATASRDKKVKVWEEPDLRDKYISRFACLKFSLAVTAVA 671 (764)
T ss_pred cCceEEeeeeecccchhhhhccccccceEEEEcccCcccceeEEecCCceEEEEeccCchhhhhhhhchhccCCceeeEE
Confidence 889999998754321 111 22 223578888988754 3333 579999999776 54444322 222333333
Q ss_pred EeeC--CCce-EEEeecCCCCcEEEEeeC------Cc-------ceEEeeccccceeEEEECCC----------CCEEEE
Q 020784 222 VSQG--VGSL-VLVCPGLQKGQVRVEHYA------SK-------RTKFIMAHDSRIACFALTQD----------GQLLAT 275 (321)
Q Consensus 222 ~s~~--~d~~-~la~sGs~dg~V~i~d~~------~~-------~~~~l~~H~~~V~~vafspd----------g~~las 275 (321)
+.+- .+.. +++ .|-..|.|.+|... +. .+....+|.+.|+.++|.|- ...||+
T Consensus 672 ~~~~~~~e~~~~va-vGle~GeI~l~~~~~~~~~~~~~~~~~~~~l~~~~~~~~aV~rl~w~p~~~~~~~~~~~~l~la~ 750 (764)
T KOG1063|consen 672 YLPVDHNEKGDVVA-VGLEKGEIVLWRRKREHRQVTVGTFNLDTRLCATIGPDSAVNRLLWRPTCSDDWVEDKEWLNLAV 750 (764)
T ss_pred eeccccccccceEE-EEecccEEEEEecccccccccceeeeeccccccccChHHhhheeEeccccccccccccceeEEee
Confidence 3321 1222 455 59999999998754 11 11123468889999999965 245799
Q ss_pred EeCCCcEEEEEEcC
Q 020784 276 SSTKGTLVRIFNTL 289 (321)
Q Consensus 276 ~S~Dgt~IrIWd~~ 289 (321)
|++|.+ +||+++.
T Consensus 751 ~g~D~~-vri~nv~ 763 (764)
T KOG1063|consen 751 GGDDES-VRIFNVD 763 (764)
T ss_pred ecccce-eEEeecc
Confidence 999999 9999874
No 180
>KOG1009 consensus Chromatin assembly complex 1 subunit B/CAC2 (contains WD40 repeats) [Chromatin structure and dynamics; Replication, recombination and repair]
Probab=99.40 E-value=4.7e-11 Score=106.43 Aligned_cols=144 Identities=13% Similarity=0.183 Sum_probs=100.5
Q ss_pred CCeEEEEEcCCCC-EEEEEcC-CcEEEEEecCC-------ceeEEeeee-cCCceEEEEEecCCCeEEEEeCCCCCCCCC
Q 020784 86 PTLLHISFNQDHG-CFAAGTD-HGFRIYNCDPF-------REIFRRDFE-RGGGIGVVEMLFRCNILALVGGGPDPQYPL 155 (321)
Q Consensus 86 ~~V~~v~fs~dg~-~lasg~~-~gv~vw~~~~~-------~~~~~~~~~-~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d 155 (321)
.+|.++.|.+++. .||+|+. ..||||-+... +..+.-.+. |...+++|.+.++++++|.++ ++
T Consensus 14 ~pv~s~dfq~n~~~~laT~G~D~~iriW~v~r~~~~~~~~~V~y~s~Ls~H~~aVN~vRf~p~gelLASg~-------D~ 86 (434)
T KOG1009|consen 14 EPVYSVDFQKNSLNKLATAGGDKDIRIWKVNRSEPGGGDMKVEYLSSLSRHTRAVNVVRFSPDGELLASGG-------DG 86 (434)
T ss_pred CceEEEEeccCcccceecccCccceeeeeeeecCCCCCceeEEEeecccCCcceeEEEEEcCCcCeeeecC-------CC
Confidence 5899999999877 8998776 56999987432 222222221 788999999999999998877 56
Q ss_pred CcEEEEeCC--------C-----Cc-E--EEEEe-eCCceeEEEEeCCeEEEE---ECCEEEEEEcCCcEEEEEEeccCC
Q 020784 156 NKVMIWDDH--------Q-----SR-C--IGELS-FRSEVRSVKLRRDRIIVV---LEQKIFVYNFADLKLLHQIETIAN 215 (321)
Q Consensus 156 ~~v~iWD~~--------~-----~~-~--~~~~~-~~~~v~~v~~~~~~~~~~---~~~~I~iwd~~~~~~~~~l~~~~~ 215 (321)
++|.+|-.. + .+ . ...+. +...|+.++|.++..++. .++.+++||+..|+++..+..|.+
T Consensus 87 g~v~lWk~~~~~~~~~d~e~~~~ke~w~v~k~lr~h~~diydL~Ws~d~~~l~s~s~dns~~l~Dv~~G~l~~~~~dh~~ 166 (434)
T KOG1009|consen 87 GEVFLWKQGDVRIFDADTEADLNKEKWVVKKVLRGHRDDIYDLAWSPDSNFLVSGSVDNSVRLWDVHAGQLLAILDDHEH 166 (434)
T ss_pred ceEEEEEecCcCCccccchhhhCccceEEEEEecccccchhhhhccCCCceeeeeeccceEEEEEeccceeEeecccccc
Confidence 999999755 2 11 1 12222 335799999998765544 357999999999999999988877
Q ss_pred CCceEEEeeCCCceEEEeecCCCC
Q 020784 216 PKGLCAVSQGVGSLVLVCPGLQKG 239 (321)
Q Consensus 216 ~~~~~~~s~~~d~~~la~sGs~dg 239 (321)
.+...++ ++-+++++. =+.|.
T Consensus 167 yvqgvaw--Dpl~qyv~s-~s~dr 187 (434)
T KOG1009|consen 167 YVQGVAW--DPLNQYVAS-KSSDR 187 (434)
T ss_pred ccceeec--chhhhhhhh-hccCc
Confidence 6554443 444456552 34443
No 181
>KOG1517 consensus Guanine nucleotide binding protein MIP1 [Cell cycle control, cell division, chromosome partitioning]
Probab=99.39 E-value=6.1e-11 Score=116.48 Aligned_cols=193 Identities=16% Similarity=0.219 Sum_probs=130.5
Q ss_pred eEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeee--cCCceEEEEEec--CCCeEEEEeCCCCCCCCCCcEEEEe
Q 020784 88 LLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFE--RGGGIGVVEMLF--RCNILALVGGGPDPQYPLNKVMIWD 162 (321)
Q Consensus 88 V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~--~~~~v~~v~~~~--~~~~~~~~sg~~~~~~~d~~v~iWD 162 (321)
-..+.|+|=...++++.+ ..|+|||.+.++........ -...|..++... +..++.+++ .||.||||+
T Consensus 1067 pk~~~~hpf~p~i~~ad~r~~i~vwd~e~~~~l~~F~n~~~~~t~Vs~l~liNe~D~aLlLtas-------~dGvIRIwk 1139 (1387)
T KOG1517|consen 1067 PKTLKFHPFEPQIAAADDRERIRVWDWEKGRLLNGFDNGAFPDTRVSDLELINEQDDALLLTAS-------SDGVIRIWK 1139 (1387)
T ss_pred CceeeecCCCceeEEcCCcceEEEEecccCceeccccCCCCCCCccceeeeecccchhheeeec-------cCceEEEec
Confidence 456778888888998886 66889999888765443321 123566666654 334555555 689999997
Q ss_pred C-----CCCcEEEEEee-C-------CceeEEEEeC--CeEEEEEC-CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCC
Q 020784 163 D-----HQSRCIGELSF-R-------SEVRSVKLRR--DRIIVVLE-QKIFVYNFADLKLLHQIETIANPKGLCAVSQGV 226 (321)
Q Consensus 163 ~-----~~~~~~~~~~~-~-------~~v~~v~~~~--~~~~~~~~-~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~ 226 (321)
- ++.+.+..... . +.-.-++|.. ..+++.++ ..|||||....+.++.+..... ..+.+++.+.
T Consensus 1140 ~y~~~~~~~eLVTaw~~Ls~~~~~~r~~~~v~dWqQ~~G~Ll~tGd~r~IRIWDa~~E~~~~diP~~s~-t~vTaLS~~~ 1218 (1387)
T KOG1517|consen 1140 DYADKWKKPELVTAWSSLSDQLPGARGTGLVVDWQQQSGHLLVTGDVRSIRIWDAHKEQVVADIPYGSS-TLVTALSADL 1218 (1387)
T ss_pred ccccccCCceeEEeeccccccCccCCCCCeeeehhhhCCeEEecCCeeEEEEEecccceeEeecccCCC-ccceeecccc
Confidence 3 22333333211 0 1112234543 34555554 5999999998888887765422 3344555543
Q ss_pred C-ceEEEeecCCCCcEEEEeeCCc----ceEEeeccccc--eeEEEECCCCC-EEEEEeCCCcEEEEEEcCC
Q 020784 227 G-SLVLVCPGLQKGQVRVEHYASK----RTKFIMAHDSR--IACFALTQDGQ-LLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 227 d-~~~la~sGs~dg~V~i~d~~~~----~~~~l~~H~~~--V~~vafspdg~-~las~S~Dgt~IrIWd~~t 290 (321)
. +.++|+ |..||.|+++|.... .+.+.+.|+.. |..+.+.+.|- .|++||.||. |++||++.
T Consensus 1219 ~~gn~i~A-GfaDGsvRvyD~R~a~~ds~v~~~R~h~~~~~Iv~~slq~~G~~elvSgs~~G~-I~~~DlR~ 1288 (1387)
T KOG1517|consen 1219 VHGNIIAA-GFADGSVRVYDRRMAPPDSLVCVYREHNDVEPIVHLSLQRQGLGELVSGSQDGD-IQLLDLRM 1288 (1387)
T ss_pred cCCceEEE-eecCCceEEeecccCCccccceeecccCCcccceeEEeecCCCcceeeeccCCe-EEEEeccc
Confidence 3 366764 999999999997643 34588999988 99999998775 4999999999 99999997
No 182
>KOG2111 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=99.39 E-value=1.1e-10 Score=101.32 Aligned_cols=168 Identities=18% Similarity=0.248 Sum_probs=121.1
Q ss_pred cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC-CCcEEEEEeeCCceeEEE---
Q 020784 107 GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH-QSRCIGELSFRSEVRSVK--- 182 (321)
Q Consensus 107 gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~-~~~~~~~~~~~~~v~~v~--- 182 (321)
.|.|||-...+.+...++ ..+|..|.+. .+.++++- .++|.||... +-+.+..++....+..+|
T Consensus 76 kviIWDD~k~~~i~el~f--~~~I~~V~l~--r~riVvvl--------~~~I~VytF~~n~k~l~~~et~~NPkGlC~~~ 143 (346)
T KOG2111|consen 76 KVIIWDDLKERCIIELSF--NSEIKAVKLR--RDRIVVVL--------ENKIYVYTFPDNPKLLHVIETRSNPKGLCSLC 143 (346)
T ss_pred eEEEEecccCcEEEEEEe--ccceeeEEEc--CCeEEEEe--------cCeEEEEEcCCChhheeeeecccCCCceEeec
Confidence 478999666667777777 6788887764 44555554 5899999987 555666665544444443
Q ss_pred EeCCe-EEEEE---CCEEEEEEcCCcEE--EEEEeccCCCCceEEEeeCCCceEEEeecCCCCc-EEEEeeCCcc-eEEe
Q 020784 183 LRRDR-IIVVL---EQKIFVYNFADLKL--LHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQ-VRVEHYASKR-TKFI 254 (321)
Q Consensus 183 ~~~~~-~~~~~---~~~I~iwd~~~~~~--~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~-V~i~d~~~~~-~~~l 254 (321)
-+... +++.- -|+|.|-|+...+. -..+..|...+.+++++.. |.++| +++..|+ |||||..++. +..+
T Consensus 144 ~~~~k~~LafPg~k~GqvQi~dL~~~~~~~p~~I~AH~s~Iacv~Ln~~--Gt~vA-TaStkGTLIRIFdt~~g~~l~E~ 220 (346)
T KOG2111|consen 144 PTSNKSLLAFPGFKTGQVQIVDLASTKPNAPSIINAHDSDIACVALNLQ--GTLVA-TASTKGTLIRIFDTEDGTLLQEL 220 (346)
T ss_pred CCCCceEEEcCCCccceEEEEEhhhcCcCCceEEEcccCceeEEEEcCC--ccEEE-EeccCcEEEEEEEcCCCcEeeee
Confidence 22233 33332 27999999966544 3677888888777777664 48888 5888886 7889988776 5566
Q ss_pred ec--cccceeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 255 MA--HDSRIACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 255 ~~--H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
+. -...|.||+||||+.+||.+|+.|| |+||.++.
T Consensus 221 RRG~d~A~iy~iaFSp~~s~LavsSdKgT-lHiF~l~~ 257 (346)
T KOG2111|consen 221 RRGVDRADIYCIAFSPNSSWLAVSSDKGT-LHIFSLRD 257 (346)
T ss_pred ecCCchheEEEEEeCCCccEEEEEcCCCe-EEEEEeec
Confidence 53 3456999999999999999999999 99999876
No 183
>PF08662 eIF2A: Eukaryotic translation initiation factor eIF2A; InterPro: IPR013979 This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins.
Probab=99.38 E-value=1.1e-10 Score=98.44 Aligned_cols=158 Identities=19% Similarity=0.270 Sum_probs=98.1
Q ss_pred EEEEcCCCCEEEEEcC----C-------cEEEEEecCCc-eeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCc
Q 020784 90 HISFNQDHGCFAAGTD----H-------GFRIYNCDPFR-EIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNK 157 (321)
Q Consensus 90 ~v~fs~dg~~lasg~~----~-------gv~vw~~~~~~-~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~ 157 (321)
.+.|+++|++|+.-.. + ...||.++... ......+...+.|..++|+|+++.++++.|. .++.
T Consensus 10 ~~~W~~~G~~l~~~~~~~~~~~~ks~~~~~~l~~~~~~~~~~~~i~l~~~~~I~~~~WsP~g~~favi~g~-----~~~~ 84 (194)
T PF08662_consen 10 KLHWQPSGDYLLVKVQTRVDKSGKSYYGEFELFYLNEKNIPVESIELKKEGPIHDVAWSPNGNEFAVIYGS-----MPAK 84 (194)
T ss_pred EEEecccCCEEEEEEEEeeccCcceEEeeEEEEEEecCCCccceeeccCCCceEEEEECcCCCEEEEEEcc-----CCcc
Confidence 5779999998774332 1 13355553221 1222222124568888888888888777653 3567
Q ss_pred EEEEeCCCCcEEEEEeeCCceeEEEEeCCeEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeec--
Q 020784 158 VMIWDDHQSRCIGELSFRSEVRSVKLRRDRIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPG-- 235 (321)
Q Consensus 158 v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sG-- 235 (321)
|.+||++ + +.+.++.. .....+.++| +|.++++.|
T Consensus 85 v~lyd~~-~--------------------------------------~~i~~~~~--~~~n~i~wsP--~G~~l~~~g~~ 121 (194)
T PF08662_consen 85 VTLYDVK-G--------------------------------------KKIFSFGT--QPRNTISWSP--DGRFLVLAGFG 121 (194)
T ss_pred cEEEcCc-c--------------------------------------cEeEeecC--CCceEEEECC--CCCEEEEEEcc
Confidence 7777764 2 22222221 2223344454 557777644
Q ss_pred CCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeC------CCcEEEEEEcCCCcEEEEEe
Q 020784 236 LQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSST------KGTLVRIFNTLDGTLLQEEC 298 (321)
Q Consensus 236 s~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~------Dgt~IrIWd~~tg~~i~~~~ 298 (321)
...|.|.+||...........|. .++.++|+|||++|||+.. |+. ++||++ +|+++.+..
T Consensus 122 n~~G~l~~wd~~~~~~i~~~~~~-~~t~~~WsPdGr~~~ta~t~~r~~~dng-~~Iw~~-~G~~l~~~~ 187 (194)
T PF08662_consen 122 NLNGDLEFWDVRKKKKISTFEHS-DATDVEWSPDGRYLATATTSPRLRVDNG-FKIWSF-QGRLLYKKP 187 (194)
T ss_pred CCCcEEEEEECCCCEEeeccccC-cEEEEEEcCCCCEEEEEEeccceecccc-EEEEEe-cCeEeEecc
Confidence 34678999999865543333343 4789999999999999864 788 999998 488877654
No 184
>KOG1445 consensus Tumor-specific antigen (contains WD repeats) [Cytoskeleton]
Probab=99.38 E-value=2.2e-11 Score=113.81 Aligned_cols=160 Identities=14% Similarity=0.119 Sum_probs=119.8
Q ss_pred CCcEEEEeCCCCcE-----EEEEeeCCceeEEEEeC---CeEEEEEC-CEEEEEEcCCc-------EEEEEEeccCCCCc
Q 020784 155 LNKVMIWDDHQSRC-----IGELSFRSEVRSVKLRR---DRIIVVLE-QKIFVYNFADL-------KLLHQIETIANPKG 218 (321)
Q Consensus 155 d~~v~iWD~~~~~~-----~~~~~~~~~v~~v~~~~---~~~~~~~~-~~I~iwd~~~~-------~~~~~l~~~~~~~~ 218 (321)
.|.|-|++++.... +..+.-...|+.+.|++ .+++++++ +.|++|.+..+ ..-..+..|...+.
T Consensus 602 gG~iai~el~~PGrLPDgv~p~l~Ngt~vtDl~WdPFD~~rLAVa~ddg~i~lWr~~a~gl~e~~~tPe~~lt~h~eKI~ 681 (1012)
T KOG1445|consen 602 GGVIAIYELNEPGRLPDGVMPGLFNGTLVTDLHWDPFDDERLAVATDDGQINLWRLTANGLPENEMTPEKILTIHGEKIT 681 (1012)
T ss_pred CceEEEEEcCCCCCCCcccccccccCceeeecccCCCChHHeeecccCceEEEEEeccCCCCcccCCcceeeecccceEE
Confidence 48899999876432 33344455789999876 47888876 59999998543 23344555555555
Q ss_pred eEEEeeCCCceEEEeecCCCCcEEEEeeCCcce-EEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcE-EEE
Q 020784 219 LCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRT-KFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTL-LQE 296 (321)
Q Consensus 219 ~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~-~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~-i~~ 296 (321)
.+.|++-.. .+|+ +.++|-+|++||+.+... ..|.+|.+.|..+||||+|+.+||.+.||+ |||++-++++. +++
T Consensus 682 slRfHPLAa-dvLa-~asyd~Ti~lWDl~~~~~~~~l~gHtdqIf~~AWSpdGr~~AtVcKDg~-~rVy~Prs~e~pv~E 758 (1012)
T KOG1445|consen 682 SLRFHPLAA-DVLA-VASYDSTIELWDLANAKLYSRLVGHTDQIFGIAWSPDGRRIATVCKDGT-LRVYEPRSREQPVYE 758 (1012)
T ss_pred EEEecchhh-hHhh-hhhccceeeeeehhhhhhhheeccCcCceeEEEECCCCcceeeeecCce-EEEeCCCCCCCcccc
Confidence 555555322 3455 489999999999998764 589999999999999999999999999999 99999988753 443
Q ss_pred Ee--CCCcceeEEEeecCceEEE
Q 020784 297 EC--CPSISAQSGLWLSSAWLRV 317 (321)
Q Consensus 297 ~~--~g~~~~~~~~s~d~~~la~ 317 (321)
-+ .|...+++.+..||+++.+
T Consensus 759 g~gpvgtRgARi~wacdgr~viv 781 (1012)
T KOG1445|consen 759 GKGPVGTRGARILWACDGRIVIV 781 (1012)
T ss_pred CCCCccCcceeEEEEecCcEEEE
Confidence 22 4566788889999999865
No 185
>KOG0303 consensus Actin-binding protein Coronin, contains WD40 repeats [Cytoskeleton]
Probab=99.38 E-value=1.6e-11 Score=109.13 Aligned_cols=147 Identities=16% Similarity=0.213 Sum_probs=104.2
Q ss_pred cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCeEEEEECCEEEEEEcCCcE
Q 020784 126 RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDRIIVVLEQKIFVYNFADLK 205 (321)
Q Consensus 126 ~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~~~I~iwd~~~~~ 205 (321)
|.+.+..++|++..+.+ +++|+ .|-+|+||++-.+.....+. +
T Consensus 80 Ht~~vLDi~w~PfnD~v-IASgS-----eD~~v~vW~IPe~~l~~~lt-------------------------------e 122 (472)
T KOG0303|consen 80 HTAPVLDIDWCPFNDCV-IASGS-----EDTKVMVWQIPENGLTRDLT-------------------------------E 122 (472)
T ss_pred ccccccccccCccCCce-eecCC-----CCceEEEEECCCcccccCcc-------------------------------c
Confidence 66777777777644333 23333 56889999876554332221 2
Q ss_pred EEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEE
Q 020784 206 LLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVR 284 (321)
Q Consensus 206 ~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~Ir 284 (321)
.+..+.+|..-++.+.+++.-.+ +|+ |.+.|.+|.||+..++. +.++. |...|.++.|+.||.+|+|.+.|+. ||
T Consensus 123 pvv~L~gH~rrVg~V~wHPtA~N-VLl-sag~Dn~v~iWnv~tgeali~l~-hpd~i~S~sfn~dGs~l~TtckDKk-vR 198 (472)
T KOG0303|consen 123 PVVELYGHQRRVGLVQWHPTAPN-VLL-SAGSDNTVSIWNVGTGEALITLD-HPDMVYSMSFNRDGSLLCTTCKDKK-VR 198 (472)
T ss_pred ceEEEeecceeEEEEeecccchh-hHh-hccCCceEEEEeccCCceeeecC-CCCeEEEEEeccCCceeeeecccce-eE
Confidence 34456666666777777776544 444 46778899999999887 45666 9999999999999999999999999 99
Q ss_pred EEEcCCCcEEEEE--eCCCcceeEEEeecCc
Q 020784 285 IFNTLDGTLLQEE--CCPSISAQSGLWLSSA 313 (321)
Q Consensus 285 IWd~~tg~~i~~~--~~g~~~~~~~~s~d~~ 313 (321)
|||-++|+++.+- ..|+...+..|--+|.
T Consensus 199 v~dpr~~~~v~e~~~heG~k~~Raifl~~g~ 229 (472)
T KOG0303|consen 199 VIDPRRGTVVSEGVAHEGAKPARAIFLASGK 229 (472)
T ss_pred EEcCCCCcEeeecccccCCCcceeEEeccCc
Confidence 9999999999876 2334444445555555
No 186
>KOG1587 consensus Cytoplasmic dynein intermediate chain [Cytoskeleton]
Probab=99.38 E-value=3.5e-11 Score=115.15 Aligned_cols=227 Identities=13% Similarity=0.059 Sum_probs=144.7
Q ss_pred CCCCCCeEEEEEcCC-CCEEEEEcCCc-EEEEEecCCce--eE---EeeeecCCceEEEEEecCC--CeEEEEeCCCCCC
Q 020784 82 SSPPPTLLHISFNQD-HGCFAAGTDHG-FRIYNCDPFRE--IF---RRDFERGGGIGVVEMLFRC--NILALVGGGPDPQ 152 (321)
Q Consensus 82 ~~~~~~V~~v~fs~d-g~~lasg~~~g-v~vw~~~~~~~--~~---~~~~~~~~~v~~v~~~~~~--~~~~~~sg~~~~~ 152 (321)
...+..|+|+.|+|. ..+||+|..+| |.+||+..... .. .....|...+..+.|..+. .-++.++
T Consensus 239 ~~~~s~v~~~~f~p~~p~ll~gG~y~GqV~lWD~~~~~~~~~s~ls~~~~sh~~~v~~vvW~~~~~~~~f~s~s------ 312 (555)
T KOG1587|consen 239 LESPSEVTCLKFCPFDPNLLAGGCYNGQVVLWDLRKGSDTPPSGLSALEVSHSEPVTAVVWLQNEHNTEFFSLS------ 312 (555)
T ss_pred EecCCceeEEEeccCCcceEEeeccCceEEEEEccCCCCCCCcccccccccCCcCeEEEEEeccCCCCceEEEe------
Confidence 344568999999995 56677777766 88999876554 11 1222255666666665433 2355655
Q ss_pred CCCCcEEEEeCCCCcE-EEE-----Ee-------eCCceeEEEEe---CCeEEEEEC-CEEEEEE---cCCcE-----EE
Q 020784 153 YPLNKVMIWDDHQSRC-IGE-----LS-------FRSEVRSVKLR---RDRIIVVLE-QKIFVYN---FADLK-----LL 207 (321)
Q Consensus 153 ~~d~~v~iWD~~~~~~-~~~-----~~-------~~~~v~~v~~~---~~~~~~~~~-~~I~iwd---~~~~~-----~~ 207 (321)
.||.|..|+++.-.. ... .. ....++++.|. +..++++++ |.|.-=+ .+... .+
T Consensus 313 -sDG~i~~W~~~~l~~P~e~~~~~~~~~~~~~~~~~~~~t~~~F~~~~p~~FiVGTe~G~v~~~~r~g~~~~~~~~~~~~ 391 (555)
T KOG1587|consen 313 -SDGSICSWDTDMLSLPVEGLLLESKKHKGQQSSKAVGATSLKFEPTDPNHFIVGTEEGKVYKGCRKGYTPAPEVSYKGH 391 (555)
T ss_pred -cCCcEeeeeccccccchhhcccccccccccccccccceeeEeeccCCCceEEEEcCCcEEEEEeccCCccccccccccc
Confidence 689999999765432 111 11 11246777775 467888876 5555422 22221 12
Q ss_pred EEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeC--CcceEEeeccccceeEEEECCCC-CEEEEEeCCCcEEE
Q 020784 208 HQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYA--SKRTKFIMAHDSRIACFALTQDG-QLLATSSTKGTLVR 284 (321)
Q Consensus 208 ~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~--~~~~~~l~~H~~~V~~vafspdg-~~las~S~Dgt~Ir 284 (321)
..+..|..++.++..++-....++. ++ |-+|+||.-. ..++..+..+...|++++|||-. ..||++..||. |.
T Consensus 392 ~~~~~h~g~v~~v~~nPF~~k~fls--~g-DW~vriWs~~~~~~Pl~~~~~~~~~v~~vaWSptrpavF~~~d~~G~-l~ 467 (555)
T KOG1587|consen 392 STFITHIGPVYAVSRNPFYPKNFLS--VG-DWTVRIWSEDVIASPLLSLDSSPDYVTDVAWSPTRPAVFATVDGDGN-LD 467 (555)
T ss_pred ccccccCcceEeeecCCCccceeee--ec-cceeEeccccCCCCcchhhhhccceeeeeEEcCcCceEEEEEcCCCc-ee
Confidence 2444556666666666654434443 33 8899999754 45677888899999999999974 57899999999 99
Q ss_pred EEEcCCCc--EEEEEeCCCcce-eEEEeecCceEEEee
Q 020784 285 IFNTLDGT--LLQEECCPSISA-QSGLWLSSAWLRVLR 319 (321)
Q Consensus 285 IWd~~tg~--~i~~~~~g~~~~-~~~~s~d~~~la~~~ 319 (321)
|||+..-. .+.+........ .+..+..|+.||+.-
T Consensus 468 iWDLl~~~~~Pv~s~~~~~~~l~~~~~s~~g~~lavGd 505 (555)
T KOG1587|consen 468 IWDLLQDDEEPVLSQKVCSPALTRVRWSPNGKLLAVGD 505 (555)
T ss_pred hhhhhccccCCcccccccccccceeecCCCCcEEEEec
Confidence 99997543 344443332222 335567788888753
No 187
>KOG1273 consensus WD40 repeat protein [General function prediction only]
Probab=99.37 E-value=3.2e-11 Score=104.42 Aligned_cols=202 Identities=12% Similarity=0.214 Sum_probs=132.5
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCC------------eEEEEeCC
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCN------------ILALVGGG 148 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~------------~~~~~sg~ 148 (321)
..|-.+|.|++||+||++|++++.|. +.+||+-.+.......| ..+|..+.+++... .+...+..
T Consensus 62 saH~~pi~sl~WS~dgr~LltsS~D~si~lwDl~~gs~l~rirf--~spv~~~q~hp~k~n~~va~~~~~sp~vi~~s~~ 139 (405)
T KOG1273|consen 62 SAHVRPITSLCWSRDGRKLLTSSRDWSIKLWDLLKGSPLKRIRF--DSPVWGAQWHPRKRNKCVATIMEESPVVIDFSDP 139 (405)
T ss_pred hccccceeEEEecCCCCEeeeecCCceeEEEeccCCCceeEEEc--cCccceeeeccccCCeEEEEEecCCcEEEEecCC
Confidence 45777999999999999999999865 77999988776666655 44444444433221 11111100
Q ss_pred --------CC--------------------CCCCCCcEEEEeCCCCcEEEEEeeCC--ceeEEEEeC--CeEEEE-ECCE
Q 020784 149 --------PD--------------------PQYPLNKVMIWDDHQSRCIGELSFRS--EVRSVKLRR--DRIIVV-LEQK 195 (321)
Q Consensus 149 --------~~--------------------~~~~d~~v~iWD~~~~~~~~~~~~~~--~v~~v~~~~--~~~~~~-~~~~ 195 (321)
++ +....|.+-++|..+.+++..++... .|.++.+.. +.+++- +|..
T Consensus 140 ~h~~Lp~d~d~dln~sas~~~fdr~g~yIitGtsKGkllv~~a~t~e~vas~rits~~~IK~I~~s~~g~~liiNtsDRv 219 (405)
T KOG1273|consen 140 KHSVLPKDDDGDLNSSASHGVFDRRGKYIITGTSKGKLLVYDAETLECVASFRITSVQAIKQIIVSRKGRFLIINTSDRV 219 (405)
T ss_pred ceeeccCCCccccccccccccccCCCCEEEEecCcceEEEEecchheeeeeeeechheeeeEEEEeccCcEEEEecCCce
Confidence 00 01134778999999999888776654 677777764 445554 4569
Q ss_pred EEEEEcCCc---------EEEEEEeccCC--CCceEEEeeCCCceEEEeecCC-CCcEEEEeeCCcc-eEEeeccc-cce
Q 020784 196 IFVYNFADL---------KLLHQIETIAN--PKGLCAVSQGVGSLVLVCPGLQ-KGQVRVEHYASKR-TKFIMAHD-SRI 261 (321)
Q Consensus 196 I~iwd~~~~---------~~~~~l~~~~~--~~~~~~~s~~~d~~~la~sGs~-dg~V~i~d~~~~~-~~~l~~H~-~~V 261 (321)
||.|+++.. +..++++.--+ .-..|+|+. ++.++++ |+. -..++||....+. ++.|.|-+ ...
T Consensus 220 IR~ye~~di~~~~r~~e~e~~~K~qDvVNk~~Wk~ccfs~--dgeYv~a-~s~~aHaLYIWE~~~GsLVKILhG~kgE~l 296 (405)
T KOG1273|consen 220 IRTYEISDIDDEGRDGEVEPEHKLQDVVNKLQWKKCCFSG--DGEYVCA-GSARAHALYIWEKSIGSLVKILHGTKGEEL 296 (405)
T ss_pred EEEEehhhhcccCccCCcChhHHHHHHHhhhhhhheeecC--CccEEEe-ccccceeEEEEecCCcceeeeecCCchhhe
Confidence 999998631 11122222111 112566655 6688875 554 3468889988877 56788877 567
Q ss_pred eEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 262 ACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 262 ~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
..|.|+|-...+++- ..|. |+||....
T Consensus 297 ~DV~whp~rp~i~si-~sg~-v~iw~~~~ 323 (405)
T KOG1273|consen 297 LDVNWHPVRPIIASI-ASGV-VYIWAVVQ 323 (405)
T ss_pred eecccccceeeeeec-cCCc-eEEEEeec
Confidence 889999999999988 5777 99998664
No 188
>KOG1538 consensus Uncharacterized conserved protein WDR10, contains WD40 repeats [General function prediction only]
Probab=99.37 E-value=5.1e-11 Score=112.05 Aligned_cols=202 Identities=13% Similarity=0.112 Sum_probs=130.0
Q ss_pred ccCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCC-----
Q 020784 80 TSSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQY----- 153 (321)
Q Consensus 80 ~~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~----- 153 (321)
...+|...|+||+|+.||++||+|+.|. |.||+-+--+. ..+. |+..|.++.+.+-...+++++-++...+
T Consensus 48 tLKgHKDtVycVAys~dGkrFASG~aDK~VI~W~~klEG~-LkYS--H~D~IQCMsFNP~~h~LasCsLsdFglWS~~qK 124 (1081)
T KOG1538|consen 48 PLKGHKDTVYCVAYAKDGKRFASGSADKSVIIWTSKLEGI-LKYS--HNDAIQCMSFNPITHQLASCSLSDFGLWSPEQK 124 (1081)
T ss_pred ccccccceEEEEEEccCCceeccCCCceeEEEecccccce-eeec--cCCeeeEeecCchHHHhhhcchhhccccChhhh
Confidence 3467899999999999999999998755 77997543322 2222 4666666665554444443332221111
Q ss_pred ---------------------------CCCcEEEEeCCCCcEEEEEee----CCceeEEEEeCC-------eEEEE-ECC
Q 020784 154 ---------------------------PLNKVMIWDDHQSRCIGELSF----RSEVRSVKLRRD-------RIIVV-LEQ 194 (321)
Q Consensus 154 ---------------------------~d~~v~iWD~~~~~~~~~~~~----~~~v~~v~~~~~-------~~~~~-~~~ 194 (321)
.+|+|.|=+- +++....++- .++|.+++|++. .+.++ .++
T Consensus 125 ~V~K~kss~R~~~CsWtnDGqylalG~~nGTIsiRNk-~gEek~~I~Rpgg~Nspiwsi~~~p~sg~G~~di~aV~DW~q 203 (1081)
T KOG1538|consen 125 SVSKHKSSSRIICCSWTNDGQYLALGMFNGTISIRNK-NGEEKVKIERPGGSNSPIWSICWNPSSGEGRNDILAVADWGQ 203 (1081)
T ss_pred hHHhhhhheeEEEeeecCCCcEEEEeccCceEEeecC-CCCcceEEeCCCCCCCCceEEEecCCCCCCccceEEEEeccc
Confidence 2345544432 2222222332 347999999864 23343 346
Q ss_pred EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEE
Q 020784 195 KIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLA 274 (321)
Q Consensus 195 ~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~la 274 (321)
++.+|.+....+-+.-.. ...-++++.-++|.++.+ |+.||.+.++....-.+-++-..+..|++|+..|++++++
T Consensus 204 TLSFy~LsG~~Igk~r~L---~FdP~CisYf~NGEy~Li-GGsdk~L~~fTR~GvrLGTvg~~D~WIWtV~~~PNsQ~v~ 279 (1081)
T KOG1538|consen 204 TLSFYQLSGKQIGKDRAL---NFDPCCISYFTNGEYILL-GGSDKQLSLFTRDGVRLGTVGEQDSWIWTVQAKPNSQYVV 279 (1081)
T ss_pred eeEEEEecceeecccccC---CCCchhheeccCCcEEEE-ccCCCceEEEeecCeEEeeccccceeEEEEEEccCCceEE
Confidence 888887764322111111 122345566666677775 8889999998766555667777889999999999999999
Q ss_pred EEeCCCcEEEEEEcCC
Q 020784 275 TSSTKGTLVRIFNTLD 290 (321)
Q Consensus 275 s~S~Dgt~IrIWd~~t 290 (321)
.|+.||| |--|++-.
T Consensus 280 ~GCqDGT-iACyNl~f 294 (1081)
T KOG1538|consen 280 VGCQDGT-IACYNLIF 294 (1081)
T ss_pred EEEccCe-eehhhhHH
Confidence 9999999 98888754
No 189
>KOG1188 consensus WD40 repeat protein [General function prediction only]
Probab=99.37 E-value=1.9e-11 Score=106.80 Aligned_cols=157 Identities=14% Similarity=0.208 Sum_probs=110.5
Q ss_pred CCCcEEEEeCCCCcEEEEEeeCC-ceeEEEEe----CCeEEEE-ECCEEEEEEcCCcEEEEEEeccCCC-CceEEEeeCC
Q 020784 154 PLNKVMIWDDHQSRCIGELSFRS-EVRSVKLR----RDRIIVV-LEQKIFVYNFADLKLLHQIETIANP-KGLCAVSQGV 226 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~~~~~~~-~v~~v~~~----~~~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~-~~~~~~s~~~ 226 (321)
+.+.|++||..+++.+.+|+... .+..+.|. ++.+.+| ++++||+||++.......+....++ ....++..+-
T Consensus 48 Sngsv~lyd~~tg~~l~~fk~~~~~~N~vrf~~~ds~h~v~s~ssDG~Vr~wD~Rs~~e~a~~~~~~~~~~~f~~ld~nc 127 (376)
T KOG1188|consen 48 SNGSVRLYDKGTGQLLEEFKGPPATTNGVRFISCDSPHGVISCSSDGTVRLWDIRSQAESARISWTQQSGTPFICLDLNC 127 (376)
T ss_pred cCCeEEEEeccchhhhheecCCCCcccceEEecCCCCCeeEEeccCCeEEEEEeecchhhhheeccCCCCCcceEeeccC
Confidence 46899999999999999998764 45556654 4556666 5689999999887666666554443 2334444443
Q ss_pred CceEEEeecCC----CCcEEEEeeCCcce--E-EeeccccceeEEEECCC-CCEEEEEeCCCcEEEEEEcCCC----cEE
Q 020784 227 GSLVLVCPGLQ----KGQVRVEHYASKRT--K-FIMAHDSRIACFALTQD-GQLLATSSTKGTLVRIFNTLDG----TLL 294 (321)
Q Consensus 227 d~~~la~sGs~----dg~V~i~d~~~~~~--~-~l~~H~~~V~~vafspd-g~~las~S~Dgt~IrIWd~~tg----~~i 294 (321)
.+.++++ |.. +-.|.+||.+..+. . -...|...|++|+|+|+ -.+|+|||.||- |.|||+..- .++
T Consensus 128 k~~ii~~-GtE~~~s~A~v~lwDvR~~qq~l~~~~eSH~DDVT~lrFHP~~pnlLlSGSvDGL-vnlfD~~~d~EeDaL~ 205 (376)
T KOG1188|consen 128 KKNIIAC-GTELTRSDASVVLWDVRSEQQLLRQLNESHNDDVTQLRFHPSDPNLLLSGSVDGL-VNLFDTKKDNEEDALL 205 (376)
T ss_pred cCCeEEe-ccccccCceEEEEEEeccccchhhhhhhhccCcceeEEecCCCCCeEEeecccce-EEeeecCCCcchhhHH
Confidence 5578875 653 55677799876542 2 35679999999999986 579999999999 999999753 245
Q ss_pred EEEeCCCcceeEEEeecC
Q 020784 295 QEECCPSISAQSGLWLSS 312 (321)
Q Consensus 295 ~~~~~g~~~~~~~~s~d~ 312 (321)
++++.+.....+.+...+
T Consensus 206 ~viN~~sSI~~igw~~~~ 223 (376)
T KOG1188|consen 206 HVINHGSSIHLIGWLSKK 223 (376)
T ss_pred HhhcccceeeeeeeecCC
Confidence 556555554444544444
No 190
>KOG4227 consensus WD40 repeat protein [General function prediction only]
Probab=99.37 E-value=4.5e-11 Score=106.19 Aligned_cols=115 Identities=17% Similarity=0.176 Sum_probs=74.4
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCC------ceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCC
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPF------REIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQY 153 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~------~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~ 153 (321)
.+.|.+-|+.+.|+.+|++||+|+++- ++||+++.. +.+......|...|-++++.- ++..+ .+|+
T Consensus 52 ~~~H~GCiNAlqFS~N~~~L~SGGDD~~~~~W~~de~~~~k~~KPI~~~~~~H~SNIF~L~F~~-~N~~~-~SG~----- 124 (609)
T KOG4227|consen 52 VREHTGCINALQFSHNDRFLASGGDDMHGRVWNVDELMVRKTPKPIGVMEHPHRSNIFSLEFDL-ENRFL-YSGE----- 124 (609)
T ss_pred hhhhccccceeeeccCCeEEeecCCcceeeeechHHHHhhcCCCCceeccCccccceEEEEEcc-CCeeE-ecCC-----
Confidence 367888999999999999999999854 889998532 333233322345566666543 33333 3344
Q ss_pred CCCcEEEEeCCCCcEEEEEeeCC---ceeEEEEeC--CeEEEEE-CCEEEEEEcC
Q 020784 154 PLNKVMIWDDHQSRCIGELSFRS---EVRSVKLRR--DRIIVVL-EQKIFVYNFA 202 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~~~~~~~---~v~~v~~~~--~~~~~~~-~~~I~iwd~~ 202 (321)
.+++|.+-|+++.+.+..+.+.. .|+.+..++ +.+++.+ ++.|.+||.+
T Consensus 125 ~~~~VI~HDiEt~qsi~V~~~~~~~~~VY~m~~~P~DN~~~~~t~~~~V~~~D~R 179 (609)
T KOG4227|consen 125 RWGTVIKHDIETKQSIYVANENNNRGDVYHMDQHPTDNTLIVVTRAKLVSFIDNR 179 (609)
T ss_pred CcceeEeeecccceeeeeecccCcccceeecccCCCCceEEEEecCceEEEEecc
Confidence 46899999998888776655543 576666665 2344443 3466666664
No 191
>KOG1240 consensus Protein kinase containing WD40 repeats [Signal transduction mechanisms]
Probab=99.35 E-value=1.4e-10 Score=115.43 Aligned_cols=216 Identities=11% Similarity=0.073 Sum_probs=145.4
Q ss_pred CCCCCCeEEEEEcCC-CCEEEEEcCCc-EEEEEecCCc-------eeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCC
Q 020784 82 SSPPPTLLHISFNQD-HGCFAAGTDHG-FRIYNCDPFR-------EIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQ 152 (321)
Q Consensus 82 ~~~~~~V~~v~fs~d-g~~lasg~~~g-v~vw~~~~~~-------~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~ 152 (321)
+.|...|..++.+++ +.+|++|++|| |+|||+.... ...++.. .+..+..+.+++.++.+|+++
T Consensus 1045 ~Ehs~~v~k~a~s~~~~s~FvsgS~DGtVKvW~~~k~~~~~~s~rS~ltys~-~~sr~~~vt~~~~~~~~Av~t------ 1117 (1431)
T KOG1240|consen 1045 HEHSSAVIKLAVSSEHTSLFVSGSDDGTVKVWNLRKLEGEGGSARSELTYSP-EGSRVEKVTMCGNGDQFAVST------ 1117 (1431)
T ss_pred hhccccccceeecCCCCceEEEecCCceEEEeeehhhhcCcceeeeeEEEec-cCCceEEEEeccCCCeEEEEc------
Confidence 556677778887765 59999999977 7799985322 2222221 367888999999999999986
Q ss_pred CCCCcEEEEeCCC--CcEE-----EEE--eeCCceeEEE-Ee---CC-eEEEEEC-CEEEEEEcCCcEEEEEEeccCCCC
Q 020784 153 YPLNKVMIWDDHQ--SRCI-----GEL--SFRSEVRSVK-LR---RD-RIIVVLE-QKIFVYNFADLKLLHQIETIANPK 217 (321)
Q Consensus 153 ~~d~~v~iWD~~~--~~~~-----~~~--~~~~~v~~v~-~~---~~-~~~~~~~-~~I~iwd~~~~~~~~~l~~~~~~~ 217 (321)
.||.|++.+++. .... ... +..+.+..+. +. .. .++.+++ +.|..||++......+++....-.
T Consensus 1118 -~DG~v~~~~id~~~~~~~~~~~~ri~n~~~~g~vv~m~a~~~~~~S~~lvy~T~~~~iv~~D~r~~~~~w~lk~~~~hG 1196 (1431)
T KOG1240|consen 1118 -KDGSVRVLRIDHYNVSKRVATQVRIPNLKKDGVVVSMHAFTAIVQSHVLVYATDLSRIVSWDTRMRHDAWRLKNQLRHG 1196 (1431)
T ss_pred -CCCeEEEEEccccccccceeeeeecccccCCCceEEeecccccccceeEEEEEeccceEEecchhhhhHHhhhcCcccc
Confidence 789999998765 2211 111 1222333322 11 12 3444555 699999999877767666544444
Q ss_pred ceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceE-E-eeccccceeEEEECCCC---CEEEEEeC-CCcEEEEEEcCCC
Q 020784 218 GLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTK-F-IMAHDSRIACFALTQDG---QLLATSST-KGTLVRIFNTLDG 291 (321)
Q Consensus 218 ~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~-~-l~~H~~~V~~vafspdg---~~las~S~-Dgt~IrIWd~~tg 291 (321)
.+.++..++.++++++ |+..|.+.+||++.+... . -.+|..+++.|+.+|-. ...++++. ..+-|-+|++.+|
T Consensus 1197 ~vTSi~idp~~~Wlvi-Gts~G~l~lWDLRF~~~i~sw~~P~~~~i~~v~~~~~~~~~S~~vs~~~~~~nevs~wn~~~g 1275 (1431)
T KOG1240|consen 1197 LVTSIVIDPWCNWLVI-GTSRGQLVLWDLRFRVPILSWEHPARAPIRHVWLCPTYPQESVSVSAGSSSNNEVSTWNMETG 1275 (1431)
T ss_pred ceeEEEecCCceEEEE-ecCCceEEEEEeecCceeecccCcccCCcceEEeeccCCCCceEEEecccCCCceeeeecccC
Confidence 5666666777789885 999999999999987643 2 23456788888877643 34555444 3344999999999
Q ss_pred cEEEEEeCCCcceeE
Q 020784 292 TLLQEECCPSISAQS 306 (321)
Q Consensus 292 ~~i~~~~~g~~~~~~ 306 (321)
.+-..+..++....+
T Consensus 1276 ~~~~vl~~s~~~p~l 1290 (1431)
T KOG1240|consen 1276 LRQTVLWASDGAPIL 1290 (1431)
T ss_pred cceEEEEcCCCCcch
Confidence 988888766454444
No 192
>KOG2321 consensus WD40 repeat protein [General function prediction only]
Probab=99.34 E-value=1.6e-10 Score=107.15 Aligned_cols=210 Identities=15% Similarity=0.180 Sum_probs=141.5
Q ss_pred CCCCeEEEEEcCCCCEEE-EEcCC-cEEEEEecCCceeEEeeeecCCceEEEEE-ecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 84 PPPTLLHISFNQDHGCFA-AGTDH-GFRIYNCDPFREIFRRDFERGGGIGVVEM-LFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~la-sg~~~-gv~vw~~~~~~~~~~~~~~~~~~v~~v~~-~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
++..-+.|..+|||+|+. +|.-+ .|++||+......+.+.+ +..+..+.. +-+-...++.- +|++|-+
T Consensus 50 ~p~ast~ik~s~DGqY~lAtG~YKP~ikvydlanLSLKFERhl--Dae~V~feiLsDD~SK~v~L~-------~DR~Ief 120 (703)
T KOG2321|consen 50 MPTASTRIKVSPDGQYLLATGTYKPQIKVYDLANLSLKFERHL--DAEVVDFEILSDDYSKSVFLQ-------NDRTIEF 120 (703)
T ss_pred CccccceeEecCCCcEEEEecccCCceEEEEcccceeeeeecc--cccceeEEEeccchhhheEee-------cCceeee
Confidence 444667899999999876 45444 499999999988888886 443333333 33333333333 3455544
Q ss_pred EeCCCCcEEEEEeeCCceeEEEEe---CCeEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCC
Q 020784 161 WDDHQSRCIGELSFRSEVRSVKLR---RDRIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQ 237 (321)
Q Consensus 161 WD~~~~~~~~~~~~~~~v~~v~~~---~~~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~ 237 (321)
-.. +..+..+..+..-..++.+ .+.++++++..|+-+|+.+|..+.-|......+.+|.++. -+.+||+ |+.
T Consensus 121 Hak--~G~hy~~RIP~~GRDm~y~~~scDly~~gsg~evYRlNLEqGrfL~P~~~~~~~lN~v~in~--~hgLla~-Gt~ 195 (703)
T KOG2321|consen 121 HAK--YGRHYRTRIPKFGRDMKYHKPSCDLYLVGSGSEVYRLNLEQGRFLNPFETDSGELNVVSINE--EHGLLAC-GTE 195 (703)
T ss_pred hhh--cCeeeeeecCcCCccccccCCCccEEEeecCcceEEEEccccccccccccccccceeeeecC--ccceEEe-ccc
Confidence 321 2222233333333344443 4566667778999999999999999988777777777765 4478885 999
Q ss_pred CCcEEEEeeCCcceE-Ee------eccccc-----eeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCccee
Q 020784 238 KGQVRVEHYASKRTK-FI------MAHDSR-----IACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQ 305 (321)
Q Consensus 238 dg~V~i~d~~~~~~~-~l------~~H~~~-----V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~ 305 (321)
+|.|..||...+... ++ ..|.+. |+++.|+.||-.+|.|..+|. |.|+|+++.+.+..-+.+..-.+
T Consensus 196 ~g~VEfwDpR~ksrv~~l~~~~~v~s~pg~~~~~svTal~F~d~gL~~aVGts~G~-v~iyDLRa~~pl~~kdh~~e~pi 274 (703)
T KOG2321|consen 196 DGVVEFWDPRDKSRVGTLDAASSVNSHPGGDAAPSVTALKFRDDGLHVAVGTSTGS-VLIYDLRASKPLLVKDHGYELPI 274 (703)
T ss_pred CceEEEecchhhhhheeeecccccCCCccccccCcceEEEecCCceeEEeeccCCc-EEEEEcccCCceeecccCCccce
Confidence 999999998876532 33 234333 999999999999999999999 99999999887654444444334
Q ss_pred EEE
Q 020784 306 SGL 308 (321)
Q Consensus 306 ~~~ 308 (321)
..+
T Consensus 275 ~~l 277 (703)
T KOG2321|consen 275 KKL 277 (703)
T ss_pred eee
Confidence 433
No 193
>KOG2110 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=99.34 E-value=5e-10 Score=98.94 Aligned_cols=178 Identities=17% Similarity=0.208 Sum_probs=129.9
Q ss_pred CEEEEEc-CCc--EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEee
Q 020784 98 GCFAAGT-DHG--FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSF 174 (321)
Q Consensus 98 ~~lasg~-~~g--v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~ 174 (321)
.++|..+ +++ .+++++.....+....| ...|-.|.+. ..+++++.- ..|.|+|+++.+.+.++..
T Consensus 57 SLvaiV~~~qpr~Lkv~~~Kk~~~ICe~~f--pt~IL~VrmN-r~RLvV~Le---------e~IyIydI~~MklLhTI~t 124 (391)
T KOG2110|consen 57 SLVAIVSIKQPRKLKVVHFKKKTTICEIFF--PTSILAVRMN-RKRLVVCLE---------ESIYIYDIKDMKLLHTIET 124 (391)
T ss_pred ceeEEEecCCCceEEEEEcccCceEEEEec--CCceEEEEEc-cceEEEEEc---------ccEEEEecccceeehhhhc
Confidence 4454333 344 67888887777666666 5666666653 334444444 4599999999998888765
Q ss_pred C-C---ceeEEEEeCCeEEEE-----ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCc-EEEE
Q 020784 175 R-S---EVRSVKLRRDRIIVV-----LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQ-VRVE 244 (321)
Q Consensus 175 ~-~---~v~~v~~~~~~~~~~-----~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~-V~i~ 244 (321)
. . .+.++.++...-.++ +.+.|.+||..+.+.+..+..|..++.+++|+++ |.+|| +++..|+ |||+
T Consensus 125 ~~~n~~gl~AlS~n~~n~ylAyp~s~t~GdV~l~d~~nl~~v~~I~aH~~~lAalafs~~--G~llA-TASeKGTVIRVf 201 (391)
T KOG2110|consen 125 TPPNPKGLCALSPNNANCYLAYPGSTTSGDVVLFDTINLQPVNTINAHKGPLAALAFSPD--GTLLA-TASEKGTVIRVF 201 (391)
T ss_pred cCCCccceEeeccCCCCceEEecCCCCCceEEEEEcccceeeeEEEecCCceeEEEECCC--CCEEE-EeccCceEEEEE
Confidence 4 2 355566665533333 2379999999999999999999888777777765 59999 5888885 6788
Q ss_pred eeCCcc-eEEeeccc--cceeEEEECCCCCEEEEEeCCCcEEEEEEcCCC
Q 020784 245 HYASKR-TKFIMAHD--SRIACFALTQDGQLLATSSTKGTLVRIFNTLDG 291 (321)
Q Consensus 245 d~~~~~-~~~l~~H~--~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg 291 (321)
....++ +..|+.-. ..|.+++|+|++++|+..|.-+| |+||.+..-
T Consensus 202 ~v~~G~kl~eFRRG~~~~~IySL~Fs~ds~~L~~sS~TeT-VHiFKL~~~ 250 (391)
T KOG2110|consen 202 SVPEGQKLYEFRRGTYPVSIYSLSFSPDSQFLAASSNTET-VHIFKLEKV 250 (391)
T ss_pred EcCCccEeeeeeCCceeeEEEEEEECCCCCeEEEecCCCe-EEEEEeccc
Confidence 887765 56776433 35889999999999999999999 999998753
No 194
>KOG1523 consensus Actin-related protein Arp2/3 complex, subunit ARPC1/p41-ARC [Cytoskeleton]
Probab=99.32 E-value=4.8e-10 Score=97.39 Aligned_cols=198 Identities=14% Similarity=0.129 Sum_probs=139.8
Q ss_pred CCeEEEEEcCCCCEEEEEcCC-cEEEEEecCCc-eeEEeeee-cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEe
Q 020784 86 PTLLHISFNQDHGCFAAGTDH-GFRIYNCDPFR-EIFRRDFE-RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWD 162 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~-gv~vw~~~~~~-~~~~~~~~-~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD 162 (321)
.+|+|-+|++|++.+|.+-.. -+.||...... .+...++. |+..+..++|.+..+.+.+++ .|+.-.||.
T Consensus 11 ~pitchAwn~drt~iAv~~~~~evhiy~~~~~~~w~~~htls~Hd~~vtgvdWap~snrIvtcs-------~drnayVw~ 83 (361)
T KOG1523|consen 11 EPITCHAWNSDRTQIAVSPNNHEVHIYSMLGADLWEPAHTLSEHDKIVTGVDWAPKSNRIVTCS-------HDRNAYVWT 83 (361)
T ss_pred CceeeeeecCCCceEEeccCCceEEEEEecCCCCceeceehhhhCcceeEEeecCCCCceeEcc-------CCCCccccc
Confidence 589999999999999999884 58899886554 22222221 788999999999999999988 788899999
Q ss_pred C-CCCcEEE---EEeeCCceeEEEEeCC--eEEEEEC-CEEEEEEcCCcEEEEEEeccCCC--CceEEEeeCCCceEEEe
Q 020784 163 D-HQSRCIG---ELSFRSEVRSVKLRRD--RIIVVLE-QKIFVYNFADLKLLHQIETIANP--KGLCAVSQGVGSLVLVC 233 (321)
Q Consensus 163 ~-~~~~~~~---~~~~~~~v~~v~~~~~--~~~~~~~-~~I~iwd~~~~~~~~~l~~~~~~--~~~~~~s~~~d~~~la~ 233 (321)
. ..+.... .+.+....++|.|.++ .+++.+. ..|.||=++..+.--.-+.-..+ ..+.+++.++++.+||+
T Consensus 84 ~~~~~~WkptlvLlRiNrAAt~V~WsP~enkFAVgSgar~isVcy~E~ENdWWVsKhikkPirStv~sldWhpnnVLlaa 163 (361)
T KOG1523|consen 84 QPSGGTWKPTLVLLRINRAATCVKWSPKENKFAVGSGARLISVCYYEQENDWWVSKHIKKPIRSTVTSLDWHPNNVLLAA 163 (361)
T ss_pred cCCCCeeccceeEEEeccceeeEeecCcCceEEeccCccEEEEEEEecccceehhhhhCCccccceeeeeccCCcceecc
Confidence 8 4444333 3566778999999875 5666654 47777766543322111111111 23455666677788885
Q ss_pred ecCCCCcEEEEee-----CCc-------------ce-EEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCc
Q 020784 234 PGLQKGQVRVEHY-----ASK-------------RT-KFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGT 292 (321)
Q Consensus 234 sGs~dg~V~i~d~-----~~~-------------~~-~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~ 292 (321)
|+.|+.++|+.. ..+ ++ .++....+.|..+.|+|+|..||=.+.|.+ |.+=|.....
T Consensus 164 -Gs~D~k~rVfSayIK~Vdekpap~pWgsk~PFG~lm~E~~~~ggwvh~v~fs~sG~~lawv~Hds~-v~~~da~~p~ 239 (361)
T KOG1523|consen 164 -GSTDGKCRVFSAYIKGVDEKPAPTPWGSKMPFGQLMSEASSSGGWVHGVLFSPSGNRLAWVGHDST-VSFVDAAGPS 239 (361)
T ss_pred -cccCcceeEEEEeeeccccCCCCCCCccCCcHHHHHHhhccCCCceeeeEeCCCCCEeeEecCCCc-eEEeecCCCc
Confidence 999999999541 111 11 133455678999999999999999999999 8888876553
No 195
>KOG1310 consensus WD40 repeat protein [General function prediction only]
Probab=99.32 E-value=2.3e-11 Score=112.15 Aligned_cols=210 Identities=12% Similarity=0.098 Sum_probs=133.7
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
..+|.+-|+|+.|+.||.+|++|+||. +.|||.-..+.+....-.|...|-++.+.+..+--++++|. .|+.|+
T Consensus 46 L~GH~GCVN~LeWn~dG~lL~SGSDD~r~ivWd~~~~KllhsI~TgHtaNIFsvKFvP~tnnriv~sgA-----gDk~i~ 120 (758)
T KOG1310|consen 46 LTGHTGCVNCLEWNADGELLASGSDDTRLIVWDPFEYKLLHSISTGHTANIFSVKFVPYTNNRIVLSGA-----GDKLIK 120 (758)
T ss_pred hccccceecceeecCCCCEEeecCCcceEEeecchhcceeeeeecccccceeEEeeeccCCCeEEEecc-----CcceEE
Confidence 368999999999999999999999987 77999887777666654467788899998865544444443 469999
Q ss_pred EEeCCCCcE----------EEEEeeC-CceeEEEEe---CCeEEEEE-CCEEEEEEcCCcE-------EEEEEe---ccC
Q 020784 160 IWDDHQSRC----------IGELSFR-SEVRSVKLR---RDRIIVVL-EQKIFVYNFADLK-------LLHQIE---TIA 214 (321)
Q Consensus 160 iWD~~~~~~----------~~~~~~~-~~v~~v~~~---~~~~~~~~-~~~I~iwd~~~~~-------~~~~l~---~~~ 214 (321)
++|+...+. ...+..+ ..|..++.. |..+.+++ |++||-||++... +...+. ...
T Consensus 121 lfdl~~~~~~~~d~~~~~~~~~~~cht~rVKria~~p~~PhtfwsasEDGtirQyDiREph~c~p~~~~~~~l~ny~~~l 200 (758)
T KOG1310|consen 121 LFDLDSSKEGGMDHGMEETTRCWSCHTDRVKRIATAPNGPHTFWSASEDGTIRQYDIREPHVCNPDEDCPSILVNYNPQL 200 (758)
T ss_pred EEecccccccccccCccchhhhhhhhhhhhhheecCCCCCceEEEecCCcceeeecccCCccCCccccccHHHHHhchhh
Confidence 999874221 1112222 245555543 34566665 5799999997411 111110 000
Q ss_pred CCCceEEEeeCCCceEEEeecCCCCcEEEEeeCC--------c-----------ceEE-eeccc--------c---ceeE
Q 020784 215 NPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYAS--------K-----------RTKF-IMAHD--------S---RIAC 263 (321)
Q Consensus 215 ~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~--------~-----------~~~~-l~~H~--------~---~V~~ 263 (321)
-...++.+++.- ..+||+ |+.|-..+++|... + .+.- -.+|- . .++-
T Consensus 201 ielk~ltisp~r-p~~laV-GgsdpfarLYD~Rr~lks~~s~~~~~~~pp~~~~cv~yf~p~hlkn~~gn~~~~~~~~t~ 278 (758)
T KOG1310|consen 201 IELKCLTISPSR-PYYLAV-GGSDPFARLYDRRRVLKSFRSDGTMNTCPPKDCRCVRYFSPGHLKNSQGNLDRYITCCTY 278 (758)
T ss_pred heeeeeeecCCC-CceEEe-cCCCchhhhhhhhhhccCCCCCccccCCCCcccchhheecCccccCcccccccceeeeEE
Confidence 112356777653 356664 88888999988320 0 0111 11222 1 2567
Q ss_pred EEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEe
Q 020784 264 FALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEEC 298 (321)
Q Consensus 264 vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~ 298 (321)
++|+|+|.-|. .++.|..|.+||+..++-...+.
T Consensus 279 vtfnpNGtElL-vs~~gEhVYlfdvn~~~~~~~y~ 312 (758)
T KOG1310|consen 279 VTFNPNGTELL-VSWGGEHVYLFDVNEDKSPTPYF 312 (758)
T ss_pred EEECCCCcEEE-EeeCCeEEEEEeecCCCCceeec
Confidence 89999997554 33445469999999988766554
No 196
>PRK04922 tolB translocation protein TolB; Provisional
Probab=99.32 E-value=9e-10 Score=104.61 Aligned_cols=202 Identities=11% Similarity=0.056 Sum_probs=127.9
Q ss_pred EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCe
Q 020784 108 FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDR 187 (321)
Q Consensus 108 v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~ 187 (321)
+.+||.+..... .... +...+....|+++++.++.++... ....|.+||+.+++......+.....+..|+++.
T Consensus 186 l~i~D~~g~~~~-~lt~-~~~~v~~p~wSpDg~~la~~s~~~----~~~~l~~~dl~~g~~~~l~~~~g~~~~~~~SpDG 259 (433)
T PRK04922 186 LQVADSDGYNPQ-TILR-SAEPILSPAWSPDGKKLAYVSFER----GRSAIYVQDLATGQRELVASFRGINGAPSFSPDG 259 (433)
T ss_pred EEEECCCCCCce-Eeec-CCCccccccCCCCCCEEEEEecCC----CCcEEEEEECCCCCEEEeccCCCCccCceECCCC
Confidence 567776544322 2221 345677778999999998876332 2357999999888765433444455577888764
Q ss_pred --EEEEE--CC--EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCc--EEEEeeCCcceEEeecccc
Q 020784 188 --IIVVL--EQ--KIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQ--VRVEHYASKRTKFIMAHDS 259 (321)
Q Consensus 188 --~~~~~--~~--~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~--V~i~d~~~~~~~~l~~H~~ 259 (321)
+++.. ++ .|++||+.+++. +.+..+.......++++ |+..++++...+|. |.+++..++....+..+..
T Consensus 260 ~~l~~~~s~~g~~~Iy~~d~~~g~~-~~lt~~~~~~~~~~~sp--DG~~l~f~sd~~g~~~iy~~dl~~g~~~~lt~~g~ 336 (433)
T PRK04922 260 RRLALTLSRDGNPEIYVMDLGSRQL-TRLTNHFGIDTEPTWAP--DGKSIYFTSDRGGRPQIYRVAASGGSAERLTFQGN 336 (433)
T ss_pred CEEEEEEeCCCCceEEEEECCCCCe-EECccCCCCccceEECC--CCCEEEEEECCCCCceEEEEECCCCCeEEeecCCC
Confidence 44332 22 799999988765 34443332223345544 55767664555565 4446665555554444445
Q ss_pred ceeEEEECCCCCEEEEEeCCC--cEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEee
Q 020784 260 RIACFALTQDGQLLATSSTKG--TLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 260 ~V~~vafspdg~~las~S~Dg--t~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~~ 319 (321)
.....+|||||++||..+.++ ..|.+||+.+++.. .+..+.......+++||++|+..+
T Consensus 337 ~~~~~~~SpDG~~Ia~~~~~~~~~~I~v~d~~~g~~~-~Lt~~~~~~~p~~spdG~~i~~~s 397 (433)
T PRK04922 337 YNARASVSPDGKKIAMVHGSGGQYRIAVMDLSTGSVR-TLTPGSLDESPSFAPNGSMVLYAT 397 (433)
T ss_pred CccCEEECCCCCEEEEEECCCCceeEEEEECCCCCeE-ECCCCCCCCCceECCCCCEEEEEE
Confidence 566899999999998765443 23899999988865 454443333458899999988764
No 197
>PRK01742 tolB translocation protein TolB; Provisional
Probab=99.31 E-value=3.3e-10 Score=107.42 Aligned_cols=198 Identities=12% Similarity=0.057 Sum_probs=125.0
Q ss_pred cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCC
Q 020784 107 GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRD 186 (321)
Q Consensus 107 gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~ 186 (321)
.+.|||.+..... .... +...+....|+++++.++.++.+. .+.+|.+||+.+++......+......+.|+++
T Consensus 185 ~i~i~d~dg~~~~-~lt~-~~~~v~~p~wSPDG~~la~~s~~~----~~~~i~i~dl~tg~~~~l~~~~g~~~~~~wSPD 258 (429)
T PRK01742 185 EVRVADYDGFNQF-IVNR-SSQPLMSPAWSPDGSKLAYVSFEN----KKSQLVVHDLRSGARKVVASFRGHNGAPAFSPD 258 (429)
T ss_pred EEEEECCCCCCce-Eecc-CCCccccceEcCCCCEEEEEEecC----CCcEEEEEeCCCCceEEEecCCCccCceeECCC
Confidence 3567776554322 2221 355678889999999998887432 235799999988764333333444557889886
Q ss_pred e--EEEEE--CCE--EEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCC--cceEEeeccc
Q 020784 187 R--IIVVL--EQK--IFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYAS--KRTKFIMAHD 258 (321)
Q Consensus 187 ~--~~~~~--~~~--I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~--~~~~~l~~H~ 258 (321)
. ++.+. ++. |.+||+.+++. ..+..+........+++ |+..|+++...+|...||++.. +....+ .|.
T Consensus 259 G~~La~~~~~~g~~~Iy~~d~~~~~~-~~lt~~~~~~~~~~wSp--DG~~i~f~s~~~g~~~I~~~~~~~~~~~~l-~~~ 334 (429)
T PRK01742 259 GSRLAFASSKDGVLNIYVMGANGGTP-SQLTSGAGNNTEPSWSP--DGQSILFTSDRSGSPQVYRMSASGGGASLV-GGR 334 (429)
T ss_pred CCEEEEEEecCCcEEEEEEECCCCCe-EeeccCCCCcCCEEECC--CCCEEEEEECCCCCceEEEEECCCCCeEEe-cCC
Confidence 4 55543 344 55557666554 44554444344455555 5566665566778888877643 323333 444
Q ss_pred cceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEee
Q 020784 259 SRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 259 ~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~~ 319 (321)
. .+.+|+|||++|+.++.++ +.+||+.+|+... +..........+++||++|+.++
T Consensus 335 ~--~~~~~SpDG~~ia~~~~~~--i~~~Dl~~g~~~~-lt~~~~~~~~~~sPdG~~i~~~s 390 (429)
T PRK01742 335 G--YSAQISADGKTLVMINGDN--VVKQDLTSGSTEV-LSSTFLDESPSISPNGIMIIYSS 390 (429)
T ss_pred C--CCccCCCCCCEEEEEcCCC--EEEEECCCCCeEE-ecCCCCCCCceECCCCCEEEEEE
Confidence 4 5678999999999888765 4469999998653 32222333457899999998865
No 198
>PRK03629 tolB translocation protein TolB; Provisional
Probab=99.31 E-value=7.8e-10 Score=104.83 Aligned_cols=204 Identities=14% Similarity=0.079 Sum_probs=131.0
Q ss_pred CCCCeEEEEEcCCCCEEEEEcC----CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 84 PPPTLLHISFNQDHGCFAAGTD----HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~----~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
+...+.+.+|+|||+.||..+. ..+.+|++.+++......+ .+......|+++++.++++.... ....|.
T Consensus 197 ~~~~~~~p~wSPDG~~la~~s~~~g~~~i~i~dl~~G~~~~l~~~--~~~~~~~~~SPDG~~La~~~~~~----g~~~I~ 270 (429)
T PRK03629 197 SPQPLMSPAWSPDGSKLAYVTFESGRSALVIQTLANGAVRQVASF--PRHNGAPAFSPDGSKLAFALSKT----GSLNLY 270 (429)
T ss_pred CCCceeeeEEcCCCCEEEEEEecCCCcEEEEEECCCCCeEEccCC--CCCcCCeEECCCCCEEEEEEcCC----CCcEEE
Confidence 4457899999999999986542 2367889887754332232 34455678999999888775321 124699
Q ss_pred EEeCCCCcEEEEEeeCCceeEEEEeCCe--EEEEEC--C--EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEe
Q 020784 160 IWDDHQSRCIGELSFRSEVRSVKLRRDR--IIVVLE--Q--KIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVC 233 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~~~v~~v~~~~~~--~~~~~~--~--~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~ 233 (321)
+||+++++..........+....|+++. ++.+.+ + .|.++|+.+++. +.+...........+++ |+..+++
T Consensus 271 ~~d~~tg~~~~lt~~~~~~~~~~wSPDG~~I~f~s~~~g~~~Iy~~d~~~g~~-~~lt~~~~~~~~~~~Sp--DG~~Ia~ 347 (429)
T PRK03629 271 VMDLASGQIRQVTDGRSNNTEPTWFPDSQNLAYTSDQAGRPQVYKVNINGGAP-QRITWEGSQNQDADVSS--DGKFMVM 347 (429)
T ss_pred EEECCCCCEEEccCCCCCcCceEECCCCCEEEEEeCCCCCceEEEEECCCCCe-EEeecCCCCccCEEECC--CCCEEEE
Confidence 9999988765544444567788898864 544443 2 555667766544 34433222233345555 5566766
Q ss_pred ecCCCC--cEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCc--EEEEEEcCCCcEEEEEe
Q 020784 234 PGLQKG--QVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGT--LVRIFNTLDGTLLQEEC 298 (321)
Q Consensus 234 sGs~dg--~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt--~IrIWd~~tg~~i~~~~ 298 (321)
.+..++ .|.+||+.++....+... .......|+|||++|+.++.|+. .+.++++ +|+..+.+.
T Consensus 348 ~~~~~g~~~I~~~dl~~g~~~~Lt~~-~~~~~p~~SpDG~~i~~~s~~~~~~~l~~~~~-~G~~~~~l~ 414 (429)
T PRK03629 348 VSSNGGQQHIAKQDLATGGVQVLTDT-FLDETPSIAPNGTMVIYSSSQGMGSVLNLVST-DGRFKARLP 414 (429)
T ss_pred EEccCCCceEEEEECCCCCeEEeCCC-CCCCCceECCCCCEEEEEEcCCCceEEEEEEC-CCCCeEECc
Confidence 555444 466688877766655532 23457889999999999998875 2556666 466666664
No 199
>KOG2445 consensus Nuclear pore complex component (sc Seh1) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=99.29 E-value=3.1e-10 Score=98.11 Aligned_cols=155 Identities=16% Similarity=0.200 Sum_probs=107.8
Q ss_pred cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCC--c--EEEEEe-eCCceeEEEEeC----CeEEEEE-CCE
Q 020784 126 RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQS--R--CIGELS-FRSEVRSVKLRR----DRIIVVL-EQK 195 (321)
Q Consensus 126 ~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~--~--~~~~~~-~~~~v~~v~~~~----~~~~~~~-~~~ 195 (321)
|..-|.++.+.|.++.+|+++ .|++|+|||.+.. . +....+ +.+.|..|.|-+ +.++.|+ |++
T Consensus 12 h~DlihdVs~D~~GRRmAtCS-------sDq~vkI~d~~~~s~~W~~Ts~Wrah~~Si~rV~WAhPEfGqvvA~cS~Drt 84 (361)
T KOG2445|consen 12 HKDLIHDVSFDFYGRRMATCS-------SDQTVKIWDSTSDSGTWSCTSSWRAHDGSIWRVVWAHPEFGQVVATCSYDRT 84 (361)
T ss_pred CcceeeeeeecccCceeeecc-------CCCcEEEEeccCCCCceEEeeeEEecCCcEEEEEecCccccceEEEEecCCc
Confidence 455688889999999999999 7899999996543 2 222333 345888898853 2355554 689
Q ss_pred EEEEEcC---------CcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeC-------------------
Q 020784 196 IFVYNFA---------DLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYA------------------- 247 (321)
Q Consensus 196 I~iwd~~---------~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~------------------- 247 (321)
++||.-. ......++......+.-+.|++..-|..+|+ .+.||++||++.-
T Consensus 85 v~iWEE~~~~~~~~~~~Wv~~ttl~DsrssV~DV~FaP~hlGLklA~-~~aDG~lRIYEA~dp~nLs~W~Lq~Ei~~~~~ 163 (361)
T KOG2445|consen 85 VSIWEEQEKSEEAHGRRWVRRTTLVDSRSSVTDVKFAPKHLGLKLAA-ASADGILRIYEAPDPMNLSQWTLQHEIQNVID 163 (361)
T ss_pred eeeeeecccccccccceeEEEEEeecCCcceeEEEecchhcceEEEE-eccCcEEEEEecCCccccccchhhhhhhhccC
Confidence 9999752 1223334444444555566666666677774 8888888887610
Q ss_pred --------------------------------------------Cc-----ceEEeeccccceeEEEECCC-C---CEEE
Q 020784 248 --------------------------------------------SK-----RTKFIMAHDSRIACFALTQD-G---QLLA 274 (321)
Q Consensus 248 --------------------------------------------~~-----~~~~l~~H~~~V~~vafspd-g---~~la 274 (321)
.. .+.++.+|..+|+.|+|.|+ | .+||
T Consensus 164 pp~~~~~~~~CvsWn~sr~~~p~iAvgs~e~a~~~~~~~Iye~~e~~rKw~kva~L~d~~dpI~di~wAPn~Gr~y~~lA 243 (361)
T KOG2445|consen 164 PPGKNKQPCFCVSWNPSRMHEPLIAVGSDEDAPHLNKVKIYEYNENGRKWLKVAELPDHTDPIRDISWAPNIGRSYHLLA 243 (361)
T ss_pred CcccccCcceEEeeccccccCceEEEEcccCCccccceEEEEecCCcceeeeehhcCCCCCcceeeeeccccCCceeeEE
Confidence 00 11245678999999999997 3 5799
Q ss_pred EEeCCCcEEEEEEcCC
Q 020784 275 TSSTKGTLVRIFNTLD 290 (321)
Q Consensus 275 s~S~Dgt~IrIWd~~t 290 (321)
+++.|| ||||++..
T Consensus 244 vA~kDg--v~I~~v~~ 257 (361)
T KOG2445|consen 244 VATKDG--VRIFKVKV 257 (361)
T ss_pred EeecCc--EEEEEEee
Confidence 999998 89999984
No 200
>PRK03629 tolB translocation protein TolB; Provisional
Probab=99.29 E-value=1.7e-09 Score=102.57 Aligned_cols=202 Identities=12% Similarity=0.057 Sum_probs=128.7
Q ss_pred EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCe
Q 020784 108 FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDR 187 (321)
Q Consensus 108 v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~ 187 (321)
+.+||.+...... ... +...+....|+++++.++.++... .+..|.+||+.+++......+...+....|+++.
T Consensus 181 l~~~d~dg~~~~~-lt~-~~~~~~~p~wSPDG~~la~~s~~~----g~~~i~i~dl~~G~~~~l~~~~~~~~~~~~SPDG 254 (429)
T PRK03629 181 LRVSDYDGYNQFV-VHR-SPQPLMSPAWSPDGSKLAYVTFES----GRSALVIQTLANGAVRQVASFPRHNGAPAFSPDG 254 (429)
T ss_pred EEEEcCCCCCCEE-eec-CCCceeeeEEcCCCCEEEEEEecC----CCcEEEEEECCCCCeEEccCCCCCcCCeEECCCC
Confidence 4455655433221 111 245677889999999998876321 2357999999888755444455556678898874
Q ss_pred --EEEEE--CC--EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEE--eeCCcceEEeecccc
Q 020784 188 --IIVVL--EQ--KIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVE--HYASKRTKFIMAHDS 259 (321)
Q Consensus 188 --~~~~~--~~--~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~--d~~~~~~~~l~~H~~ 259 (321)
++... ++ .|.+||+.+++..+ +..+........++ +|+..|+++...+|...|| +..++....+..+..
T Consensus 255 ~~La~~~~~~g~~~I~~~d~~tg~~~~-lt~~~~~~~~~~wS--PDG~~I~f~s~~~g~~~Iy~~d~~~g~~~~lt~~~~ 331 (429)
T PRK03629 255 SKLAFALSKTGSLNLYVMDLASGQIRQ-VTDGRSNNTEPTWF--PDSQNLAYTSDQAGRPQVYKVNINGGAPQRITWEGS 331 (429)
T ss_pred CEEEEEEcCCCCcEEEEEECCCCCEEE-ccCCCCCcCceEEC--CCCCEEEEEeCCCCCceEEEEECCCCCeEEeecCCC
Confidence 44432 22 69999998876543 33332233334444 4557676645555655554 555555555555556
Q ss_pred ceeEEEECCCCCEEEEEeCCC--cEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEee
Q 020784 260 RIACFALTQDGQLLATSSTKG--TLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 260 ~V~~vafspdg~~las~S~Dg--t~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~~ 319 (321)
.+.+.+|+|||++||..+.++ ..|.+||+.+|+. ..+..........+++||++|+.++
T Consensus 332 ~~~~~~~SpDG~~Ia~~~~~~g~~~I~~~dl~~g~~-~~Lt~~~~~~~p~~SpDG~~i~~~s 392 (429)
T PRK03629 332 QNQDADVSSDGKFMVMVSSNGGQQHIAKQDLATGGV-QVLTDTFLDETPSIAPNGTMVIYSS 392 (429)
T ss_pred CccCEEECCCCCEEEEEEccCCCceEEEEECCCCCe-EEeCCCCCCCCceECCCCCEEEEEE
Confidence 677899999999998876543 2388899999875 3454333333458899999998865
No 201
>KOG1524 consensus WD40 repeat-containing protein CHE-2 [General function prediction only]
Probab=99.28 E-value=6.2e-11 Score=109.02 Aligned_cols=194 Identities=11% Similarity=0.003 Sum_probs=132.0
Q ss_pred EEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEE-EeeCCce
Q 020784 100 FAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGE-LSFRSEV 178 (321)
Q Consensus 100 lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~-~~~~~~v 178 (321)
+++.+|+.+.|-+. .++.+..... |.+.+.+-.|.+++..+.+++ .||.||+|.- +|-...+ .++...|
T Consensus 79 ~i~s~DGkf~il~k-~~rVE~sv~A-H~~A~~~gRW~~dGtgLlt~G-------EDG~iKiWSr-sGMLRStl~Q~~~~v 148 (737)
T KOG1524|consen 79 LICSNDGRFVILNK-SARVERSISA-HAAAISSGRWSPDGAGLLTAG-------EDGVIKIWSR-SGMLRSTVVQNEESI 148 (737)
T ss_pred EEEcCCceEEEecc-cchhhhhhhh-hhhhhhhcccCCCCceeeeec-------CCceEEEEec-cchHHHHHhhcCcee
Confidence 33444444555442 2333223333 677888888999999888888 7899999974 3332222 3456689
Q ss_pred eEEEEeCC--eEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEEeec
Q 020784 179 RSVKLRRD--RIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKFIMA 256 (321)
Q Consensus 179 ~~v~~~~~--~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~ 256 (321)
+++.|.++ .++.|.++.+.|=-+.....+-..+.|.+-+.++++ ++-..+++ +|+.|-..+|||.....+.+-..
T Consensus 149 ~c~~W~p~S~~vl~c~g~h~~IKpL~~n~k~i~WkAHDGiiL~~~W--~~~s~lI~-sgGED~kfKvWD~~G~~Lf~S~~ 225 (737)
T KOG1524|consen 149 RCARWAPNSNSIVFCQGGHISIKPLAANSKIIRWRAHDGLVLSLSW--STQSNIIA-SGGEDFRFKIWDAQGANLFTSAA 225 (737)
T ss_pred EEEEECCCCCceEEecCCeEEEeecccccceeEEeccCcEEEEeec--Ccccccee-ecCCceeEEeecccCcccccCCh
Confidence 99999875 456666777777777555555566777665555554 44557777 69999999999998888889999
Q ss_pred cccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEee
Q 020784 257 HDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 257 H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~~ 319 (321)
|.-+|++|+|+|+ ..+|.+|.. + .|+=..+ ......++.|.||..++++.
T Consensus 226 ~ey~ITSva~npd-~~~~v~S~n-t-~R~~~p~----------~GSifnlsWS~DGTQ~a~gt 275 (737)
T KOG1524|consen 226 EEYAITSVAFNPE-KDYLLWSYN-T-ARFSSPR----------VGSIFNLSWSADGTQATCGT 275 (737)
T ss_pred hccceeeeeeccc-cceeeeeee-e-eeecCCC----------ccceEEEEEcCCCceeeccc
Confidence 9999999999999 788888854 4 6622222 22334556677777776643
No 202
>KOG1009 consensus Chromatin assembly complex 1 subunit B/CAC2 (contains WD40 repeats) [Chromatin structure and dynamics; Replication, recombination and repair]
Probab=99.27 E-value=5.3e-11 Score=106.09 Aligned_cols=141 Identities=17% Similarity=0.229 Sum_probs=104.5
Q ss_pred eCCceeEEEEeCCe---EEEEE-CCEEEEEEcCCc---------EEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCc
Q 020784 174 FRSEVRSVKLRRDR---IIVVL-EQKIFVYNFADL---------KLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQ 240 (321)
Q Consensus 174 ~~~~v~~v~~~~~~---~~~~~-~~~I~iwd~~~~---------~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~ 240 (321)
.+.+|+++.|+++. ++.++ |..||+|-+... +.+..+..|...+.++.|+++ +.+|| ||+.+|.
T Consensus 12 ~~~pv~s~dfq~n~~~~laT~G~D~~iriW~v~r~~~~~~~~~V~y~s~Ls~H~~aVN~vRf~p~--gelLA-Sg~D~g~ 88 (434)
T KOG1009|consen 12 DHEPVYSVDFQKNSLNKLATAGGDKDIRIWKVNRSEPGGGDMKVEYLSSLSRHTRAVNVVRFSPD--GELLA-SGGDGGE 88 (434)
T ss_pred CCCceEEEEeccCcccceecccCccceeeeeeeecCCCCCceeEEEeecccCCcceeEEEEEcCC--cCeee-ecCCCce
Confidence 45578899988654 34443 469999987421 234455667777777777665 48898 6999999
Q ss_pred EEEEeeC--------C-----c----ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcc
Q 020784 241 VRVEHYA--------S-----K----RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSIS 303 (321)
Q Consensus 241 V~i~d~~--------~-----~----~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~ 303 (321)
|.+|-.. + + ..+.+.+|...|..++|+||+.+++++|.|.+ +++||+..|+++..+. +|..
T Consensus 89 v~lWk~~~~~~~~~d~e~~~~ke~w~v~k~lr~h~~diydL~Ws~d~~~l~s~s~dns-~~l~Dv~~G~l~~~~~-dh~~ 166 (434)
T KOG1009|consen 89 VFLWKQGDVRIFDADTEADLNKEKWVVKKVLRGHRDDIYDLAWSPDSNFLVSGSVDNS-VRLWDVHAGQLLAILD-DHEH 166 (434)
T ss_pred EEEEEecCcCCccccchhhhCccceEEEEEecccccchhhhhccCCCceeeeeeccce-EEEEEeccceeEeecc-cccc
Confidence 9999765 2 1 12367899999999999999999999999999 9999999999998884 4554
Q ss_pred eeEEEeecC--ceEEEee
Q 020784 304 AQSGLWLSS--AWLRVLR 319 (321)
Q Consensus 304 ~~~~~s~d~--~~la~~~ 319 (321)
-...+.+|+ +|++..+
T Consensus 167 yvqgvawDpl~qyv~s~s 184 (434)
T KOG1009|consen 167 YVQGVAWDPLNQYVASKS 184 (434)
T ss_pred ccceeecchhhhhhhhhc
Confidence 444455554 7776543
No 203
>KOG4328 consensus WD40 protein [Function unknown]
Probab=99.27 E-value=1.4e-10 Score=104.79 Aligned_cols=181 Identities=18% Similarity=0.110 Sum_probs=118.4
Q ss_pred cCCceEEEEEecCCC-eEEEEeCCCCCCCCCCcEEEEeCCCCc----EEEEE-eeCCceeEEEEeCC---eEEE-EECCE
Q 020784 126 RGGGIGVVEMLFRCN-ILALVGGGPDPQYPLNKVMIWDDHQSR----CIGEL-SFRSEVRSVKLRRD---RIIV-VLEQK 195 (321)
Q Consensus 126 ~~~~v~~v~~~~~~~-~~~~~sg~~~~~~~d~~v~iWD~~~~~----~~~~~-~~~~~v~~v~~~~~---~~~~-~~~~~ 195 (321)
+.+.|.++++++.-+ .++++|+ .-|+|-+||+.+.+ -+.-+ .+..+|.++.|++. +++. ..||+
T Consensus 185 ~~~Rit~l~fHPt~~~~lva~Gd------K~G~VG~Wn~~~~~~d~d~v~~f~~hs~~Vs~l~F~P~n~s~i~ssSyDGt 258 (498)
T KOG4328|consen 185 TDRRITSLAFHPTENRKLVAVGD------KGGQVGLWNFGTQEKDKDGVYLFTPHSGPVSGLKFSPANTSQIYSSSYDGT 258 (498)
T ss_pred cccceEEEEecccCcceEEEEcc------CCCcEEEEecCCCCCccCceEEeccCCccccceEecCCChhheeeeccCce
Confidence 578999999999777 4444443 24999999995322 12222 33457999999873 4444 46899
Q ss_pred EEEEEcCCcE--EEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc--eEEeeccccceeEEEECCCC-
Q 020784 196 IFVYNFADLK--LLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR--TKFIMAHDSRIACFALTQDG- 270 (321)
Q Consensus 196 I~iwd~~~~~--~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~--~~~l~~H~~~V~~vafspdg- 270 (321)
||+=|+.+.. .+..++........+.++.. +..+++ |..=|...+||.+... +..+.-|+..|++|+++|-.
T Consensus 259 iR~~D~~~~i~e~v~s~~~d~~~fs~~d~~~e-~~~vl~--~~~~G~f~~iD~R~~~s~~~~~~lh~kKI~sv~~NP~~p 335 (498)
T KOG4328|consen 259 IRLQDFEGNISEEVLSLDTDNIWFSSLDFSAE-SRSVLF--GDNVGNFNVIDLRTDGSEYENLRLHKKKITSVALNPVCP 335 (498)
T ss_pred eeeeeecchhhHHHhhcCccceeeeeccccCC-CccEEE--eecccceEEEEeecCCccchhhhhhhcccceeecCCCCc
Confidence 9999997643 23333322222333444433 233443 5555688889887643 45678899999999999975
Q ss_pred CEEEEEeCCCcEEEEEEcCCCc-----EEEEEeCCCcceeEEEeecCceEE
Q 020784 271 QLLATSSTKGTLVRIFNTLDGT-----LLQEECCPSISAQSGLWLSSAWLR 316 (321)
Q Consensus 271 ~~las~S~Dgt~IrIWd~~tg~-----~i~~~~~g~~~~~~~~s~d~~~la 316 (321)
.+|||||.|++ .+|||++... .+.++..........||+++--|+
T Consensus 336 ~~laT~s~D~T-~kIWD~R~l~~K~sp~lst~~HrrsV~sAyFSPs~gtl~ 385 (498)
T KOG4328|consen 336 WFLATASLDQT-AKIWDLRQLRGKASPFLSTLPHRRSVNSAYFSPSGGTLL 385 (498)
T ss_pred hheeecccCcc-eeeeehhhhcCCCCcceecccccceeeeeEEcCCCCceE
Confidence 57999999999 9999998632 255554333333447787774443
No 204
>PRK05137 tolB translocation protein TolB; Provisional
Probab=99.26 E-value=3.3e-09 Score=100.81 Aligned_cols=186 Identities=10% Similarity=0.035 Sum_probs=124.5
Q ss_pred cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCe--EEEEEC----CEEEEE
Q 020784 126 RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDR--IIVVLE----QKIFVY 199 (321)
Q Consensus 126 ~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~--~~~~~~----~~I~iw 199 (321)
+...+....|+++++.++.++... .+..|.+||+.+++......+...+....|+++. ++...+ ..|.+|
T Consensus 200 ~~~~v~~p~wSpDG~~lay~s~~~----g~~~i~~~dl~~g~~~~l~~~~g~~~~~~~SPDG~~la~~~~~~g~~~Iy~~ 275 (435)
T PRK05137 200 GSSLVLTPRFSPNRQEITYMSYAN----GRPRVYLLDLETGQRELVGNFPGMTFAPRFSPDGRKVVMSLSQGGNTDIYTM 275 (435)
T ss_pred CCCCeEeeEECCCCCEEEEEEecC----CCCEEEEEECCCCcEEEeecCCCcccCcEECCCCCEEEEEEecCCCceEEEE
Confidence 456788889999999988887432 2478999999988765433445566778888764 443332 368888
Q ss_pred EcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCC--cEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEe
Q 020784 200 NFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKG--QVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSS 277 (321)
Q Consensus 200 d~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg--~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S 277 (321)
|+.+++. ..+..+........+++ |+..+++....+| .|.+++...+....+..+...+...+|+|||++||..+
T Consensus 276 d~~~~~~-~~Lt~~~~~~~~~~~sp--DG~~i~f~s~~~g~~~Iy~~d~~g~~~~~lt~~~~~~~~~~~SpdG~~ia~~~ 352 (435)
T PRK05137 276 DLRSGTT-TRLTDSPAIDTSPSYSP--DGSQIVFESDRSGSPQLYVMNADGSNPRRISFGGGRYSTPVWSPRGDLIAFTK 352 (435)
T ss_pred ECCCCce-EEccCCCCccCceeEcC--CCCEEEEEECCCCCCeEEEEECCCCCeEEeecCCCcccCeEECCCCCEEEEEE
Confidence 9987765 34544433333455555 5566665444444 56667877766666655666778899999999998876
Q ss_pred CCC--cEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEee
Q 020784 278 TKG--TLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 278 ~Dg--t~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~~ 319 (321)
.++ ..|.+||+.++. .+.+..+.......+++||++|+.++
T Consensus 353 ~~~~~~~i~~~d~~~~~-~~~lt~~~~~~~p~~spDG~~i~~~~ 395 (435)
T PRK05137 353 QGGGQFSIGVMKPDGSG-ERILTSGFLVEGPTWAPNGRVIMFFR 395 (435)
T ss_pred cCCCceEEEEEECCCCc-eEeccCCCCCCCCeECCCCCEEEEEE
Confidence 543 237888886554 34454444444558899999998764
No 205
>PRK04922 tolB translocation protein TolB; Provisional
Probab=99.25 E-value=2.7e-09 Score=101.31 Aligned_cols=204 Identities=12% Similarity=0.055 Sum_probs=127.7
Q ss_pred CCCCeEEEEEcCCCCEEEEEcC-C---cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 84 PPPTLLHISFNQDHGCFAAGTD-H---GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~-~---gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
+...|.+.+|+|||+.|+..+. + .+.+||+.+++......+ .+......|+++++.+++....+ ....|.
T Consensus 202 ~~~~v~~p~wSpDg~~la~~s~~~~~~~l~~~dl~~g~~~~l~~~--~g~~~~~~~SpDG~~l~~~~s~~----g~~~Iy 275 (433)
T PRK04922 202 SAEPILSPAWSPDGKKLAYVSFERGRSAIYVQDLATGQRELVASF--RGINGAPSFSPDGRRLALTLSRD----GNPEIY 275 (433)
T ss_pred CCCccccccCCCCCCEEEEEecCCCCcEEEEEECCCCCEEEeccC--CCCccCceECCCCCEEEEEEeCC----CCceEE
Confidence 4457899999999999997764 2 377899987765333222 34445678899998887654221 134799
Q ss_pred EEeCCCCcEEEEEeeCCceeEEEEeCC--eEEEEEC--C--EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEe
Q 020784 160 IWDDHQSRCIGELSFRSEVRSVKLRRD--RIIVVLE--Q--KIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVC 233 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~~~v~~v~~~~~--~~~~~~~--~--~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~ 233 (321)
+||+.+++...............|+++ .++.+.+ + .|.++|+.+++.. .+..........++++ |+..+++
T Consensus 276 ~~d~~~g~~~~lt~~~~~~~~~~~spDG~~l~f~sd~~g~~~iy~~dl~~g~~~-~lt~~g~~~~~~~~Sp--DG~~Ia~ 352 (433)
T PRK04922 276 VMDLGSRQLTRLTNHFGIDTEPTWAPDGKSIYFTSDRGGRPQIYRVAASGGSAE-RLTFQGNYNARASVSP--DGKKIAM 352 (433)
T ss_pred EEECCCCCeEECccCCCCccceEECCCCCEEEEEECCCCCceEEEEECCCCCeE-EeecCCCCccCEEECC--CCCEEEE
Confidence 999998876443333334456788875 3555543 2 5777787766543 3332222223345555 5566765
Q ss_pred ecCCCC--cEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCC--cEEEEEEcCCCcEEEEEe
Q 020784 234 PGLQKG--QVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKG--TLVRIFNTLDGTLLQEEC 298 (321)
Q Consensus 234 sGs~dg--~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dg--t~IrIWd~~tg~~i~~~~ 298 (321)
....++ .|.+|+..++....+. +.......+|+|||++|+..+.++ ..|.++++. |...+.+.
T Consensus 353 ~~~~~~~~~I~v~d~~~g~~~~Lt-~~~~~~~p~~spdG~~i~~~s~~~g~~~L~~~~~~-g~~~~~l~ 419 (433)
T PRK04922 353 VHGSGGQYRIAVMDLSTGSVRTLT-PGSLDESPSFAPNGSMVLYATREGGRGVLAAVSTD-GRVRQRLV 419 (433)
T ss_pred EECCCCceeEEEEECCCCCeEECC-CCCCCCCceECCCCCEEEEEEecCCceEEEEEECC-CCceEEcc
Confidence 433333 5777998777666554 333456789999999888777642 236677774 44445553
No 206
>KOG2394 consensus WD40 protein DMR-N9 [General function prediction only]
Probab=99.24 E-value=1e-09 Score=101.14 Aligned_cols=156 Identities=13% Similarity=0.175 Sum_probs=107.0
Q ss_pred CCCcEEEEeCCCCcEEEEEee-----CCceeEEEEeCC---eEEEE-ECCEEEEEEcC--------------CcEEEEEE
Q 020784 154 PLNKVMIWDDHQSRCIGELSF-----RSEVRSVKLRRD---RIIVV-LEQKIFVYNFA--------------DLKLLHQI 210 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~~~~~-----~~~v~~v~~~~~---~~~~~-~~~~I~iwd~~--------------~~~~~~~l 210 (321)
.-|.|.+.|....+....+.. ...|+++.|-+. .++++ .++.+.+||.. .+......
T Consensus 193 ~tGqvq~idp~~~~~sklfne~r~i~ktsvT~ikWvpg~~~~Fl~a~~sGnlyly~~~~~~~~t~p~~~~~k~~~~f~i~ 272 (636)
T KOG2394|consen 193 TTGQVQLIDPINFEVSKLFNEERLINKSSVTCIKWVPGSDSLFLVAHASGNLYLYDKEIVCGATAPSYQALKDGDQFAIL 272 (636)
T ss_pred ccCceEEecchhhHHHHhhhhcccccccceEEEEEEeCCCceEEEEEecCceEEeeccccccCCCCcccccCCCCeeEEe
Confidence 347788888766433222221 247899998642 23333 46788888652 11111111
Q ss_pred e--c--cCCCC--------ceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceE-EeeccccceeEEEECCCCCEEEEEe
Q 020784 211 E--T--IANPK--------GLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTK-FIMAHDSRIACFALTQDGQLLATSS 277 (321)
Q Consensus 211 ~--~--~~~~~--------~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~-~l~~H~~~V~~vafspdg~~las~S 277 (321)
. . ..+++ .+..|++.+|+.+||+ -+.||.+||+++.+..+. .++..=+...||+|||||+|+|||+
T Consensus 273 t~ksk~~rNPv~~w~~~~g~in~f~FS~DG~~LA~-VSqDGfLRvF~fdt~eLlg~mkSYFGGLLCvcWSPDGKyIvtGG 351 (636)
T KOG2394|consen 273 TSKSKKTRNPVARWHIGEGSINEFAFSPDGKYLAT-VSQDGFLRIFDFDTQELLGVMKSYFGGLLCVCWSPDGKYIVTGG 351 (636)
T ss_pred eeeccccCCccceeEeccccccceeEcCCCceEEE-EecCceEEEeeccHHHHHHHHHhhccceEEEEEcCCccEEEecC
Confidence 1 1 11222 2334455557899996 899999999998776644 5666667899999999999999999
Q ss_pred CCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecC
Q 020784 278 TKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSS 312 (321)
Q Consensus 278 ~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~ 312 (321)
+|.- |.||.+..++++..- .||..=+..+.||+
T Consensus 352 EDDL-VtVwSf~erRVVARG-qGHkSWVs~VaFDp 384 (636)
T KOG2394|consen 352 EDDL-VTVWSFEERRVVARG-QGHKSWVSVVAFDP 384 (636)
T ss_pred Ccce-EEEEEeccceEEEec-cccccceeeEeecc
Confidence 9998 999999999999866 67887777778886
No 207
>KOG1963 consensus WD40 repeat protein [General function prediction only]
Probab=99.24 E-value=1.3e-09 Score=105.48 Aligned_cols=226 Identities=13% Similarity=0.137 Sum_probs=151.9
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCcE-EEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHGF-RIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~gv-~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
+=|-++|++++|+.||.+|.+|+.-+| .+|.+++.+..+-..+ ++.|..+.+++++++.+++. .|+.|.+
T Consensus 248 HWH~~~V~~L~fS~~G~~LlSGG~E~VLv~Wq~~T~~kqfLPRL--gs~I~~i~vS~ds~~~sl~~-------~DNqI~l 318 (792)
T KOG1963|consen 248 HWHHDEVNSLSFSSDGAYLLSGGREGVLVLWQLETGKKQFLPRL--GSPILHIVVSPDSDLYSLVL-------EDNQIHL 318 (792)
T ss_pred EecccccceeEEecCCceEeecccceEEEEEeecCCCccccccc--CCeeEEEEEcCCCCeEEEEe-------cCceEEE
Confidence 446679999999999999999999765 5999999987776666 78999999999999999888 6799988
Q ss_pred EeCCCCcEEEEEee---C---------CceeEEEEeCC--eEEEEE-CCEEEEEEcCCcEEEEEEecc-----CCC----
Q 020784 161 WDDHQSRCIGELSF---R---------SEVRSVKLRRD--RIIVVL-EQKIFVYNFADLKLLHQIETI-----ANP---- 216 (321)
Q Consensus 161 WD~~~~~~~~~~~~---~---------~~v~~v~~~~~--~~~~~~-~~~I~iwd~~~~~~~~~l~~~-----~~~---- 216 (321)
-...+......+.+ . +-.+.+++++. .++..+ .+.|.+||+.+.+.+.+++.. ...
T Consensus 319 i~~~dl~~k~tIsgi~~~~~~~k~~~~~l~t~~~idpr~~~~vln~~~g~vQ~ydl~td~~i~~~~v~~~n~~~~~~n~~ 398 (792)
T KOG1963|consen 319 IKASDLEIKSTISGIKPPTPSTKTRPQSLTTGVSIDPRTNSLVLNGHPGHVQFYDLYTDSTIYKLQVCDENYSDGDVNIQ 398 (792)
T ss_pred EeccchhhhhhccCccCCCccccccccccceeEEEcCCCCceeecCCCceEEEEeccccceeeeEEEEeecccCCcceeE
Confidence 87654443333222 1 22456777773 233333 369999999887777766431 111
Q ss_pred CceEEEeeCCCceEEEee-------cCCCCcEEE--EeeCCcc----eE--EeeccccceeEEEECC-CCC-EEEEEeCC
Q 020784 217 KGLCAVSQGVGSLVLVCP-------GLQKGQVRV--EHYASKR----TK--FIMAHDSRIACFALTQ-DGQ-LLATSSTK 279 (321)
Q Consensus 217 ~~~~~~s~~~d~~~la~s-------Gs~dg~V~i--~d~~~~~----~~--~l~~H~~~V~~vafsp-dg~-~las~S~D 279 (321)
+.+.++...-.+.+++.. ...||.+.+ |-+.... +. ....|...+...+|.+ ... .++|+|.|
T Consensus 399 v~itav~~~~~gs~maT~E~~~d~~~~~~~e~~LKFW~~n~~~kt~~L~T~I~~PH~~~~vat~~~~~~rs~~~vta~~d 478 (792)
T KOG1963|consen 399 VGITAVARSRFGSWMATLEARIDKFNFFDGEVSLKFWQYNPNSKTFILNTKINNPHGNAFVATIFLNPTRSVRCVTASVD 478 (792)
T ss_pred EeeeeehhhccceEEEEeeeeehhhhccCceEEEEEEEEcCCcceeEEEEEEecCCCceeEEEEEecCcccceeEEeccC
Confidence 223333333345677641 345776666 8765432 22 3457988877777753 333 79999999
Q ss_pred CcEEEEEEcCCCc----------E--EEEEeCCCcceeEEEeecCceEEEe
Q 020784 280 GTLVRIFNTLDGT----------L--LQEECCPSISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 280 gt~IrIWd~~tg~----------~--i~~~~~g~~~~~~~~s~d~~~la~~ 318 (321)
|. +|||-+..-+ | +..| ........+|+-||..||++
T Consensus 479 g~-~KiW~~~~~~n~~k~~s~W~c~~i~sy-~k~~i~a~~fs~dGslla~s 527 (792)
T KOG1963|consen 479 GD-FKIWVFTDDSNIYKKSSNWTCKAIGSY-HKTPITALCFSQDGSLLAVS 527 (792)
T ss_pred Ce-EEEEEEecccccCcCccceEEeeeecc-ccCcccchhhcCCCcEEEEe
Confidence 99 9999984322 1 2222 22233345888999999885
No 208
>PRK02889 tolB translocation protein TolB; Provisional
Probab=99.24 E-value=5.6e-09 Score=98.99 Aligned_cols=186 Identities=13% Similarity=0.054 Sum_probs=118.1
Q ss_pred cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCe--EEEEE--CCE--EEEE
Q 020784 126 RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDR--IIVVL--EQK--IFVY 199 (321)
Q Consensus 126 ~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~--~~~~~--~~~--I~iw 199 (321)
+...+....|+++++.++.++... ....|.+||+.+++......+...+....|+++. ++... ++. |.++
T Consensus 194 ~~~~v~~p~wSPDG~~la~~s~~~----~~~~I~~~dl~~g~~~~l~~~~g~~~~~~~SPDG~~la~~~~~~g~~~Iy~~ 269 (427)
T PRK02889 194 SPEPIISPAWSPDGTKLAYVSFES----KKPVVYVHDLATGRRRVVANFKGSNSAPAWSPDGRTLAVALSRDGNSQIYTV 269 (427)
T ss_pred CCCCcccceEcCCCCEEEEEEccC----CCcEEEEEECCCCCEEEeecCCCCccceEECCCCCEEEEEEccCCCceEEEE
Confidence 356677889999999998877432 2356999999988765444455566778898864 44433 344 5555
Q ss_pred EcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEee--CCcceEEeeccccceeEEEECCCCCEEEEEe
Q 020784 200 NFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHY--ASKRTKFIMAHDSRIACFALTQDGQLLATSS 277 (321)
Q Consensus 200 d~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~--~~~~~~~l~~H~~~V~~vafspdg~~las~S 277 (321)
|+..++ .+.+..+........+++ |+..+++.+..+|...||.+ ..+....+..+.......+|||||++||..+
T Consensus 270 d~~~~~-~~~lt~~~~~~~~~~wSp--DG~~l~f~s~~~g~~~Iy~~~~~~g~~~~lt~~g~~~~~~~~SpDG~~Ia~~s 346 (427)
T PRK02889 270 NADGSG-LRRLTQSSGIDTEPFFSP--DGRSIYFTSDRGGAPQIYRMPASGGAAQRVTFTGSYNTSPRISPDGKLLAYIS 346 (427)
T ss_pred ECCCCC-cEECCCCCCCCcCeEEcC--CCCEEEEEecCCCCcEEEEEECCCCceEEEecCCCCcCceEECCCCCEEEEEE
Confidence 555544 344544333333445555 55666654555566677654 3444333333334455789999999999877
Q ss_pred CCC--cEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEee
Q 020784 278 TKG--TLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 278 ~Dg--t~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~~ 319 (321)
.++ ..|.+||+.+++.. .+..+.......+++||++|+.++
T Consensus 347 ~~~g~~~I~v~d~~~g~~~-~lt~~~~~~~p~~spdg~~l~~~~ 389 (427)
T PRK02889 347 RVGGAFKLYVQDLATGQVT-ALTDTTRDESPSFAPNGRYILYAT 389 (427)
T ss_pred ccCCcEEEEEEECCCCCeE-EccCCCCccCceECCCCCEEEEEE
Confidence 654 13999999998764 343333334458899999998875
No 209
>PF08662 eIF2A: Eukaryotic translation initiation factor eIF2A; InterPro: IPR013979 This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins.
Probab=99.21 E-value=5e-10 Score=94.53 Aligned_cols=100 Identities=13% Similarity=0.069 Sum_probs=75.3
Q ss_pred CCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCC---CcEEEEEEcCCCc
Q 020784 216 PKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTK---GTLVRIFNTLDGT 292 (321)
Q Consensus 216 ~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~D---gt~IrIWd~~tg~ 292 (321)
++..++++|+++ .++++.|..++.|.+||.+.+.+..+ +...++.|.|||+|++||+|+.+ |. |++||+++.+
T Consensus 61 ~I~~~~WsP~g~-~favi~g~~~~~v~lyd~~~~~i~~~--~~~~~n~i~wsP~G~~l~~~g~~n~~G~-l~~wd~~~~~ 136 (194)
T PF08662_consen 61 PIHDVAWSPNGN-EFAVIYGSMPAKVTLYDVKGKKIFSF--GTQPRNTISWSPDGRFLVLAGFGNLNGD-LEFWDVRKKK 136 (194)
T ss_pred ceEEEEECcCCC-EEEEEEccCCcccEEEcCcccEeEee--cCCCceEEEECCCCCEEEEEEccCCCcE-EEEEECCCCE
Confidence 344445555443 23344588888999999976656555 45678999999999999998754 56 9999999999
Q ss_pred EEEEEeCCCcceeEEEeecCceEEEeec
Q 020784 293 LLQEECCPSISAQSGLWLSSAWLRVLRT 320 (321)
Q Consensus 293 ~i~~~~~g~~~~~~~~s~d~~~la~~~~ 320 (321)
.+.+++.. ....+.+++||+||+++.+
T Consensus 137 ~i~~~~~~-~~t~~~WsPdGr~~~ta~t 163 (194)
T PF08662_consen 137 KISTFEHS-DATDVEWSPDGRYLATATT 163 (194)
T ss_pred EeeccccC-cEEEEEEcCCCCEEEEEEe
Confidence 99988543 3456689999999999865
No 210
>PRK05137 tolB translocation protein TolB; Provisional
Probab=99.20 E-value=1.2e-08 Score=96.99 Aligned_cols=204 Identities=7% Similarity=-0.023 Sum_probs=128.0
Q ss_pred CCCCCeEEEEEcCCCCEEEEEcC----CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcE
Q 020784 83 SPPPTLLHISFNQDHGCFAAGTD----HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg~~lasg~~----~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
.+...|.+.+|+|||+.|+..+. ..+.+||+.+++...... +.+.+....|+++++.+++....+ ....|
T Consensus 199 ~~~~~v~~p~wSpDG~~lay~s~~~g~~~i~~~dl~~g~~~~l~~--~~g~~~~~~~SPDG~~la~~~~~~----g~~~I 272 (435)
T PRK05137 199 DGSSLVLTPRFSPNRQEITYMSYANGRPRVYLLDLETGQRELVGN--FPGMTFAPRFSPDGRKVVMSLSQG----GNTDI 272 (435)
T ss_pred cCCCCeEeeEECCCCCEEEEEEecCCCCEEEEEECCCCcEEEeec--CCCcccCcEECCCCCEEEEEEecC----CCceE
Confidence 45568999999999999987653 237799998776532222 245566778999999887665321 12458
Q ss_pred EEEeCCCCcEEEEEeeCCceeEEEEeCC--eEEEEEC----CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEE
Q 020784 159 MIWDDHQSRCIGELSFRSEVRSVKLRRD--RIIVVLE----QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLV 232 (321)
Q Consensus 159 ~iWD~~~~~~~~~~~~~~~v~~v~~~~~--~~~~~~~----~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la 232 (321)
.+||+.++................|+++ .++..++ ..|.+||+..++. +.+..+........+++ |+..|+
T Consensus 273 y~~d~~~~~~~~Lt~~~~~~~~~~~spDG~~i~f~s~~~g~~~Iy~~d~~g~~~-~~lt~~~~~~~~~~~Sp--dG~~ia 349 (435)
T PRK05137 273 YTMDLRSGTTTRLTDSPAIDTSPSYSPDGSQIVFESDRSGSPQLYVMNADGSNP-RRISFGGGRYSTPVWSP--RGDLIA 349 (435)
T ss_pred EEEECCCCceEEccCCCCccCceeEcCCCCEEEEEECCCCCCeEEEEECCCCCe-EEeecCCCcccCeEECC--CCCEEE
Confidence 8889988776443333334556788876 3555543 2788899876654 33433222233345555 556666
Q ss_pred eecCCCC--cEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCC-----cEEEEEEcCCCcEEEEE
Q 020784 233 CPGLQKG--QVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKG-----TLVRIFNTLDGTLLQEE 297 (321)
Q Consensus 233 ~sGs~dg--~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dg-----t~IrIWd~~tg~~i~~~ 297 (321)
+.....+ .|.+++...+....+. +...+....|+|||+.|+..+.++ ..+.+.|+..++. +.+
T Consensus 350 ~~~~~~~~~~i~~~d~~~~~~~~lt-~~~~~~~p~~spDG~~i~~~~~~~~~~~~~~L~~~dl~g~~~-~~l 419 (435)
T PRK05137 350 FTKQGGGQFSIGVMKPDGSGERILT-SGFLVEGPTWAPNGRVIMFFRQTPGSGGAPKLYTVDLTGRNE-REV 419 (435)
T ss_pred EEEcCCCceEEEEEECCCCceEecc-CCCCCCCCeECCCCCEEEEEEccCCCCCcceEEEEECCCCce-EEc
Confidence 5443333 4556787655544443 233578899999999887765532 2377778766554 444
No 211
>KOG1517 consensus Guanine nucleotide binding protein MIP1 [Cell cycle control, cell division, chromosome partitioning]
Probab=99.20 E-value=4.8e-10 Score=110.39 Aligned_cols=192 Identities=15% Similarity=0.210 Sum_probs=123.3
Q ss_pred EEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEE-ecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCc
Q 020784 90 HISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEM-LFRCNILALVGGGPDPQYPLNKVMIWDDHQSR 167 (321)
Q Consensus 90 ~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~-~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~ 167 (321)
-+.|.+..-+|.++++ +.|||||.+.-..+....+..+..+..+.. ...++.++.+- .||.||+||.+...
T Consensus 1170 v~dWqQ~~G~Ll~tGd~r~IRIWDa~~E~~~~diP~~s~t~vTaLS~~~~~gn~i~AGf-------aDGsvRvyD~R~a~ 1242 (1387)
T KOG1517|consen 1170 VVDWQQQSGHLLVTGDVRSIRIWDAHKEQVVADIPYGSSTLVTALSADLVHGNIIAAGF-------ADGSVRVYDRRMAP 1242 (1387)
T ss_pred eeehhhhCCeEEecCCeeEEEEEecccceeEeecccCCCccceeecccccCCceEEEee-------cCCceEEeecccCC
Confidence 3568876555555554 889999998776655554422233344333 22355555443 68999999987542
Q ss_pred ---EEEEEe-eCC--ceeEEEEeCCe---EEE-EECCEEEEEEcCCcEE--EEEEeccCCCC-ceEEEeeCCCceEEEee
Q 020784 168 ---CIGELS-FRS--EVRSVKLRRDR---IIV-VLEQKIFVYNFADLKL--LHQIETIANPK-GLCAVSQGVGSLVLVCP 234 (321)
Q Consensus 168 ---~~~~~~-~~~--~v~~v~~~~~~---~~~-~~~~~I~iwd~~~~~~--~~~l~~~~~~~-~~~~~s~~~d~~~la~s 234 (321)
.+.... +.. .|..+.+.+.+ ++. +++|.|++||++.... .-++..+-... ...++..+....++| +
T Consensus 1243 ~ds~v~~~R~h~~~~~Iv~~slq~~G~~elvSgs~~G~I~~~DlR~~~~e~~~~iv~~~~yGs~lTal~VH~hapiiA-s 1321 (1387)
T KOG1517|consen 1243 PDSLVCVYREHNDVEPIVHLSLQRQGLGELVSGSQDGDIQLLDLRMSSKETFLTIVAHWEYGSALTALTVHEHAPIIA-S 1321 (1387)
T ss_pred ccccceeecccCCcccceeEEeecCCCcceeeeccCCeEEEEecccCcccccceeeeccccCccceeeeeccCCCeee-e
Confidence 233332 222 37788887632 333 3578999999986322 12222222112 144444454557888 4
Q ss_pred cCCCCcEEEEeeCCcceEEeecc-------ccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCC
Q 020784 235 GLQKGQVRVEHYASKRTKFIMAH-------DSRIACFALTQDGQLLATSSTKGTLVRIFNTLDG 291 (321)
Q Consensus 235 Gs~dg~V~i~d~~~~~~~~l~~H-------~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg 291 (321)
|+. +.|+||+.....+..++.+ .+.+.|++|+|---+||.|+.|.+ |.|+.-..+
T Consensus 1322 Gs~-q~ikIy~~~G~~l~~~k~n~~F~~q~~gs~scL~FHP~~~llAaG~~Ds~-V~iYs~~k~ 1383 (1387)
T KOG1517|consen 1322 GSA-QLIKIYSLSGEQLNIIKYNPGFMGQRIGSVSCLAFHPHRLLLAAGSADST-VSIYSCEKP 1383 (1387)
T ss_pred cCc-ceEEEEecChhhhcccccCcccccCcCCCcceeeecchhHhhhhccCCce-EEEeecCCc
Confidence 888 8999999988777655543 457899999999999999999998 999876554
No 212
>PRK02889 tolB translocation protein TolB; Provisional
Probab=99.14 E-value=1.4e-08 Score=96.22 Aligned_cols=202 Identities=13% Similarity=0.104 Sum_probs=121.5
Q ss_pred CCCCCeEEEEEcCCCCEEEEEcC-Cc---EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcE
Q 020784 83 SPPPTLLHISFNQDHGCFAAGTD-HG---FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg~~lasg~~-~g---v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
.+...|.+.+|+|||+.|+..+. ++ +.+||+.+++......+ .+......|+++++.+++... .++..
T Consensus 193 ~~~~~v~~p~wSPDG~~la~~s~~~~~~~I~~~dl~~g~~~~l~~~--~g~~~~~~~SPDG~~la~~~~------~~g~~ 264 (427)
T PRK02889 193 SSPEPIISPAWSPDGTKLAYVSFESKKPVVYVHDLATGRRRVVANF--KGSNSAPAWSPDGRTLAVALS------RDGNS 264 (427)
T ss_pred cCCCCcccceEcCCCCEEEEEEccCCCcEEEEEECCCCCEEEeecC--CCCccceEECCCCCEEEEEEc------cCCCc
Confidence 34567899999999999987764 22 77899988765433222 445567789999998887543 23555
Q ss_pred EEE--eCCCCcEEEEEee-CCceeEEEEeCCe--EEEEEC--CEEEEE--EcCCcEEEEEEeccCCCCceEEEeeCCCce
Q 020784 159 MIW--DDHQSRCIGELSF-RSEVRSVKLRRDR--IIVVLE--QKIFVY--NFADLKLLHQIETIANPKGLCAVSQGVGSL 229 (321)
Q Consensus 159 ~iW--D~~~~~~~~~~~~-~~~v~~v~~~~~~--~~~~~~--~~I~iw--d~~~~~~~~~l~~~~~~~~~~~~s~~~d~~ 229 (321)
.|| |...+.. ..+.. ........|+++. ++.+++ +...+| ++.+++. +.+..........++++ |+.
T Consensus 265 ~Iy~~d~~~~~~-~~lt~~~~~~~~~~wSpDG~~l~f~s~~~g~~~Iy~~~~~~g~~-~~lt~~g~~~~~~~~Sp--DG~ 340 (427)
T PRK02889 265 QIYTVNADGSGL-RRLTQSSGIDTEPFFSPDGRSIYFTSDRGGAPQIYRMPASGGAA-QRVTFTGSYNTSPRISP--DGK 340 (427)
T ss_pred eEEEEECCCCCc-EECCCCCCCCcCeEEcCCCCEEEEEecCCCCcEEEEEECCCCce-EEEecCCCCcCceEECC--CCC
Confidence 555 5555443 33332 2345567788763 554443 344445 5555443 22322222222345555 557
Q ss_pred EEEeecCCCC--cEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcE--EEEEEcCCCcEEEEEe
Q 020784 230 VLVCPGLQKG--QVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTL--VRIFNTLDGTLLQEEC 298 (321)
Q Consensus 230 ~la~sGs~dg--~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~--IrIWd~~tg~~i~~~~ 298 (321)
.+++....+| .|.+||+.++....+..+ ......+|+|||+.|+.++.++.. +.+-++ +|+..+.+.
T Consensus 341 ~Ia~~s~~~g~~~I~v~d~~~g~~~~lt~~-~~~~~p~~spdg~~l~~~~~~~g~~~l~~~~~-~g~~~~~l~ 411 (427)
T PRK02889 341 LLAYISRVGGAFKLYVQDLATGQVTALTDT-TRDESPSFAPNGRYILYATQQGGRSVLAAVSS-DGRIKQRLS 411 (427)
T ss_pred EEEEEEccCCcEEEEEEECCCCCeEEccCC-CCccCceECCCCCEEEEEEecCCCEEEEEEEC-CCCceEEee
Confidence 7776444444 577799887766655433 345788999999998888766631 333344 466555553
No 213
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=99.14 E-value=2.5e-08 Score=94.03 Aligned_cols=184 Identities=13% Similarity=0.055 Sum_probs=121.9
Q ss_pred CCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCe--EEEEEC----CEEEEEE
Q 020784 127 GGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDR--IIVVLE----QKIFVYN 200 (321)
Q Consensus 127 ~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~--~~~~~~----~~I~iwd 200 (321)
...+....|+++++.++.+.... ....|.+||+.+++......+...+.+..|+++. ++...+ ..|.+||
T Consensus 189 ~~~~~~p~~Spdg~~la~~~~~~----~~~~i~v~d~~~g~~~~~~~~~~~~~~~~~spDg~~l~~~~~~~~~~~i~~~d 264 (417)
T TIGR02800 189 REPILSPAWSPDGQKLAYVSFES----GKPEIYVQDLATGQREKVASFPGMNGAPAFSPDGSKLAVSLSKDGNPDIYVMD 264 (417)
T ss_pred CCceecccCCCCCCEEEEEEcCC----CCcEEEEEECCCCCEEEeecCCCCccceEECCCCCEEEEEECCCCCccEEEEE
Confidence 44567778899999998876332 2367999999988765444455566778898763 544432 3799999
Q ss_pred cCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCC--cEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeC
Q 020784 201 FADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKG--QVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSST 278 (321)
Q Consensus 201 ~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg--~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~ 278 (321)
+.+++. ..+..+........+++ |+..|+++...+| .|.+++..++....+..+...+..++|+|+|++|+.++.
T Consensus 265 ~~~~~~-~~l~~~~~~~~~~~~s~--dg~~l~~~s~~~g~~~iy~~d~~~~~~~~l~~~~~~~~~~~~spdg~~i~~~~~ 341 (417)
T TIGR02800 265 LDGKQL-TRLTNGPGIDTEPSWSP--DGKSIAFTSDRGGSPQIYMMDADGGEVRRLTFRGGYNASPSWSPDGDLIAFVHR 341 (417)
T ss_pred CCCCCE-EECCCCCCCCCCEEECC--CCCEEEEEECCCCCceEEEEECCCCCEEEeecCCCCccCeEECCCCCEEEEEEc
Confidence 987654 33333332223345554 5566655444444 466677766666666666777889999999999998887
Q ss_pred CC---cEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEee
Q 020784 279 KG---TLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 279 Dg---t~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~~ 319 (321)
++ . |.+||+.++... .+..........+++||++|++++
T Consensus 342 ~~~~~~-i~~~d~~~~~~~-~l~~~~~~~~p~~spdg~~l~~~~ 383 (417)
T TIGR02800 342 EGGGFN-IAVMDLDGGGER-VLTDTGLDESPSFAPNGRMILYAT 383 (417)
T ss_pred cCCceE-EEEEeCCCCCeE-EccCCCCCCCceECCCCCEEEEEE
Confidence 76 5 889999887653 332222223347889999988764
No 214
>KOG4497 consensus Uncharacterized conserved protein WDR8, contains WD repeats [General function prediction only]
Probab=99.12 E-value=1.3e-09 Score=95.21 Aligned_cols=195 Identities=14% Similarity=0.068 Sum_probs=129.2
Q ss_pred EEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEE
Q 020784 90 HISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCI 169 (321)
Q Consensus 90 ~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~ 169 (321)
-++|||+|+++|+.++-.+.|=|.++.+....... -..|..++|..+...+..+. +.++.|.+|++...+..
T Consensus 13 ~c~fSp~g~yiAs~~~yrlviRd~~tlq~~qlf~c--ldki~yieW~ads~~ilC~~------yk~~~vqvwsl~Qpew~ 84 (447)
T KOG4497|consen 13 FCSFSPCGNYIASLSRYRLVIRDSETLQLHQLFLC--LDKIVYIEWKADSCHILCVA------YKDPKVQVWSLVQPEWY 84 (447)
T ss_pred ceeECCCCCeeeeeeeeEEEEeccchhhHHHHHHH--HHHhhheeeeccceeeeeee------eccceEEEEEeecceeE
Confidence 38899999999999987777878777654322221 23466778877666555443 35789999999998887
Q ss_pred EEEeeCC-ceeEEEEeCCe--EEEEE--CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeec---------
Q 020784 170 GELSFRS-EVRSVKLRRDR--IIVVL--EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPG--------- 235 (321)
Q Consensus 170 ~~~~~~~-~v~~v~~~~~~--~~~~~--~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sG--------- 235 (321)
..++... .+.+++|+++. ++..+ +-.|.+|.+.+.+... ++...... -.+++++|+++.|+..
T Consensus 85 ckIdeg~agls~~~WSPdgrhiL~tseF~lriTVWSL~t~~~~~-~~~pK~~~--kg~~f~~dg~f~ai~sRrDCkdyv~ 161 (447)
T KOG4497|consen 85 CKIDEGQAGLSSISWSPDGRHILLTSEFDLRITVWSLNTQKGYL-LPHPKTNV--KGYAFHPDGQFCAILSRRDCKDYVQ 161 (447)
T ss_pred EEeccCCCcceeeeECCCcceEeeeecceeEEEEEEeccceeEE-ecccccCc--eeEEECCCCceeeeeecccHHHHHH
Confidence 7777654 67889999986 22222 3599999998765432 22222222 3334444556555421
Q ss_pred -------------------------CCCCc-EEEEeeCCcceEEeeccc-cceeEEEECCCCCEEEEEeCCCcEEEEEEc
Q 020784 236 -------------------------LQKGQ-VRVEHYASKRTKFIMAHD-SRIACFALTQDGQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 236 -------------------------s~dg~-V~i~d~~~~~~~~l~~H~-~~V~~vafspdg~~las~S~Dgt~IrIWd~ 288 (321)
+-||. +.+||.-. ..+.+..|. -.+..++|+|.+++||.||.|+. +||-|-
T Consensus 162 i~~c~~W~ll~~f~~dT~DltgieWsPdg~~laVwd~~L-eykv~aYe~~lG~k~v~wsP~~qflavGsyD~~-lrvlnh 239 (447)
T KOG4497|consen 162 ISSCKAWILLKEFKLDTIDLTGIEWSPDGNWLAVWDNVL-EYKVYAYERGLGLKFVEWSPCNQFLAVGSYDQM-LRVLNH 239 (447)
T ss_pred HHhhHHHHHHHhcCCCcccccCceECCCCcEEEEecchh-hheeeeeeeccceeEEEeccccceEEeeccchh-hhhhce
Confidence 11443 44476422 233444554 56999999999999999999999 999887
Q ss_pred CCCcEEEEE
Q 020784 289 LDGTLLQEE 297 (321)
Q Consensus 289 ~tg~~i~~~ 297 (321)
-+-+.+.+|
T Consensus 240 ~tWk~f~ef 248 (447)
T KOG4497|consen 240 FTWKPFGEF 248 (447)
T ss_pred eeeeehhhh
Confidence 766655443
No 215
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=99.12 E-value=3.7e-08 Score=82.94 Aligned_cols=186 Identities=12% Similarity=0.074 Sum_probs=117.8
Q ss_pred CCeEEEEEcCCC-CEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC
Q 020784 86 PTLLHISFNQDH-GCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH 164 (321)
Q Consensus 86 ~~V~~v~fs~dg-~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~ 164 (321)
..|+++-..|.. ..|..|+|..+.-||+++++....... |..-+-++.-.. .+..++ +|+ .||++||||++
T Consensus 115 PeINam~ldP~enSi~~AgGD~~~y~~dlE~G~i~r~~rG-HtDYvH~vv~R~-~~~qil-sG~-----EDGtvRvWd~k 186 (325)
T KOG0649|consen 115 PEINAMWLDPSENSILFAGGDGVIYQVDLEDGRIQREYRG-HTDYVHSVVGRN-ANGQIL-SGA-----EDGTVRVWDTK 186 (325)
T ss_pred CccceeEeccCCCcEEEecCCeEEEEEEecCCEEEEEEcC-Ccceeeeeeecc-cCccee-ecC-----CCccEEEEecc
Confidence 378999999765 455555555566999999987555443 444444443322 222233 333 58999999999
Q ss_pred CCcEEEEEeeC-----------CceeEEEEeCCeEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEe
Q 020784 165 QSRCIGELSFR-----------SEVRSVKLRRDRIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVC 233 (321)
Q Consensus 165 ~~~~~~~~~~~-----------~~v~~v~~~~~~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~ 233 (321)
+++++..+..- .-|.+++.+.+.++++.+..+.+|.++..+...+|..... +..+.|-. | ++++
T Consensus 187 t~k~v~~ie~yk~~~~lRp~~g~wigala~~edWlvCGgGp~lslwhLrsse~t~vfpipa~-v~~v~F~~--d-~vl~- 261 (325)
T KOG0649|consen 187 TQKHVSMIEPYKNPNLLRPDWGKWIGALAVNEDWLVCGGGPKLSLWHLRSSESTCVFPIPAR-VHLVDFVD--D-CVLI- 261 (325)
T ss_pred ccceeEEeccccChhhcCcccCceeEEEeccCceEEecCCCceeEEeccCCCceEEEecccc-eeEeeeec--c-eEEE-
Confidence 99998876521 2367788888888888888999999999998888865432 33444433 2 4554
Q ss_pred ecCCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEE-EeCCCcEEEEE
Q 020784 234 PGLQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLAT-SSTKGTLVRIF 286 (321)
Q Consensus 234 sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las-~S~Dgt~IrIW 286 (321)
|+....|.-|.++.........-...+++..++-.--.++| ++..+. +.|+
T Consensus 262 -~G~g~~v~~~~l~Gvl~a~ip~~s~~c~s~s~~~~p~k~~s~ag~s~~-~~i~ 313 (325)
T KOG0649|consen 262 -GGEGNHVQSYTLNGVLQANIPVESTACYSASWQTSPIKFISIAGFSNK-LHIL 313 (325)
T ss_pred -eccccceeeeeeccEEEEeccCCccceeeecccCCceEEEEeccccee-eeee
Confidence 55556777787754333344444445666666644444444 344444 5555
No 216
>KOG4547 consensus WD40 repeat-containing protein [General function prediction only]
Probab=99.12 E-value=7.9e-09 Score=96.35 Aligned_cols=156 Identities=13% Similarity=0.148 Sum_probs=115.4
Q ss_pred CCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeC----CceeEEEEe------C--------------C--eEEEEE
Q 020784 139 CNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFR----SEVRSVKLR------R--------------D--RIIVVL 192 (321)
Q Consensus 139 ~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~----~~v~~v~~~------~--------------~--~~~~~~ 192 (321)
..++|... .||.+||||..+++...+|.-. +.-++..|. + + .++.++
T Consensus 5 ~~~~A~~~-------~~g~l~iw~t~~~~~~~e~~p~~~~s~t~~~~~w~L~~~~s~~k~~~~~~~~~~s~~t~~lvlgt 77 (541)
T KOG4547|consen 5 LDYFALST-------GDGRLRIWDTAKNQLQQEFAPIASLSGTCTYTKWGLSADYSPMKWLSLEKAKKASLDTSMLVLGT 77 (541)
T ss_pred hheEeecC-------CCCeEEEEEccCceeeeeeccchhccCcceeEEEEEEeccchHHHHhHHHHhhccCCceEEEeec
Confidence 34566666 5699999999999988877532 222222221 1 1 233333
Q ss_pred -CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcce-EEeeccccceeEEEECCCC
Q 020784 193 -EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRT-KFIMAHDSRIACFALTQDG 270 (321)
Q Consensus 193 -~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~-~~l~~H~~~V~~vafspdg 270 (321)
.+.|-+|++..+++-.++.+..++..+.++..+.+ ....+|++.|+.|.+|+...+.. ..++.-...+.+++++|||
T Consensus 78 ~~g~v~~ys~~~g~it~~~st~~h~~~v~~~~~~~~-~~ciyS~~ad~~v~~~~~~~~~~~~~~~~~~~~~~sl~is~D~ 156 (541)
T KOG4547|consen 78 PQGSVLLYSVAGGEITAKLSTDKHYGNVNEILDAQR-LGCIYSVGADLKVVYILEKEKVIIRIWKEQKPLVSSLCISPDG 156 (541)
T ss_pred CCccEEEEEecCCeEEEEEecCCCCCcceeeecccc-cCceEecCCceeEEEEecccceeeeeeccCCCccceEEEcCCC
Confidence 36999999999999999987777666766664433 22334789999999999988764 4778888899999999999
Q ss_pred CEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeE
Q 020784 271 QLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQS 306 (321)
Q Consensus 271 ~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~ 306 (321)
..|++||. . |++||+++++.+.+| .||...+.
T Consensus 157 ~~l~~as~--~-ik~~~~~~kevv~~f-tgh~s~v~ 188 (541)
T KOG4547|consen 157 KILLTASR--Q-IKVLDIETKEVVITF-TGHGSPVR 188 (541)
T ss_pred CEEEeccc--e-EEEEEccCceEEEEe-cCCCcceE
Confidence 99999973 3 999999999999999 57775544
No 217
>KOG2139 consensus WD40 repeat protein [General function prediction only]
Probab=99.11 E-value=9.1e-09 Score=90.93 Aligned_cols=190 Identities=16% Similarity=0.148 Sum_probs=118.3
Q ss_pred CCeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC
Q 020784 86 PTLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH 164 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~ 164 (321)
-.++.++|++.-..||++.. +.|||||... .+....+......+.+++|.+-+.....++ ..+.|.||...
T Consensus 99 ~dlr~~aWhqH~~~fava~nddvVriy~kss-t~pt~Lks~sQrnvtclawRPlsaselavg-------Cr~gIciW~~s 170 (445)
T KOG2139|consen 99 IDLRGVAWHQHIIAFAVATNDDVVRIYDKSS-TCPTKLKSVSQRNVTCLAWRPLSASELAVG-------CRAGICIWSDS 170 (445)
T ss_pred cceeeEeechhhhhhhhhccCcEEEEeccCC-CCCceecchhhcceeEEEeccCCcceeeee-------ecceeEEEEcC
Confidence 47889999997777887776 6788999765 322223221246789999988655443333 24679999754
Q ss_pred CC----cEE--------EEEee--CCceeEEEEeCCeEEEEE----CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCC
Q 020784 165 QS----RCI--------GELSF--RSEVRSVKLRRDRIIVVL----EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGV 226 (321)
Q Consensus 165 ~~----~~~--------~~~~~--~~~v~~v~~~~~~~~~~~----~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~ 226 (321)
.. ..+ ..++. +..|+++.|+++....++ +..|+|||..++..+.-.......+....++|++
T Consensus 171 ~tln~~r~~~~~s~~~~qvl~~pgh~pVtsmqwn~dgt~l~tAS~gsssi~iWdpdtg~~~pL~~~glgg~slLkwSPdg 250 (445)
T KOG2139|consen 171 RTLNANRNIRMMSTHHLQVLQDPGHNPVTSMQWNEDGTILVTASFGSSSIMIWDPDTGQKIPLIPKGLGGFSLLKWSPDG 250 (445)
T ss_pred cccccccccccccccchhheeCCCCceeeEEEEcCCCCEEeecccCcceEEEEcCCCCCcccccccCCCceeeEEEcCCC
Confidence 22 111 11222 347999999998755443 3599999998876654432233334456677765
Q ss_pred CceEEEeecCCCCcEEEEeeCC-cceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEc
Q 020784 227 GSLVLVCPGLQKGQVRVEHYAS-KRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 227 d~~~la~sGs~dg~V~i~d~~~-~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~ 288 (321)
| .++| .+.|+..++|.... .......--.+.|...+|+|+|++|.-++..-. +|+.+
T Consensus 251 d-~lfa--At~davfrlw~e~q~wt~erw~lgsgrvqtacWspcGsfLLf~~sgsp--~lysl 308 (445)
T KOG2139|consen 251 D-VLFA--ATCDAVFRLWQENQSWTKERWILGSGRVQTACWSPCGSFLLFACSGSP--RLYSL 308 (445)
T ss_pred C-EEEE--ecccceeeeehhcccceecceeccCCceeeeeecCCCCEEEEEEcCCc--eEEEE
Confidence 4 3444 58899999995432 211111222348999999999987654443322 35544
No 218
>PF02239 Cytochrom_D1: Cytochrome D1 heme domain; PDB: 1NNO_B 1HZU_A 1N15_B 1N50_A 1GJQ_A 1BL9_B 1NIR_B 1N90_B 1HZV_A 1AOQ_A ....
Probab=99.08 E-value=2.3e-07 Score=86.07 Aligned_cols=197 Identities=14% Similarity=0.140 Sum_probs=126.9
Q ss_pred CEEE-EEcC-CcEEEEEecCCceeEEeeeecCCce-EEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEee
Q 020784 98 GCFA-AGTD-HGFRIYNCDPFREIFRRDFERGGGI-GVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSF 174 (321)
Q Consensus 98 ~~la-sg~~-~gv~vw~~~~~~~~~~~~~~~~~~v-~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~ 174 (321)
++++ +-.+ +.|.|.|.++.+.+..... .+.. ..+.++++++.+.+++ .|+.|.++|+.+++.+.++..
T Consensus 6 ~l~~V~~~~~~~v~viD~~t~~~~~~i~~--~~~~h~~~~~s~Dgr~~yv~~-------rdg~vsviD~~~~~~v~~i~~ 76 (369)
T PF02239_consen 6 NLFYVVERGSGSVAVIDGATNKVVARIPT--GGAPHAGLKFSPDGRYLYVAN-------RDGTVSVIDLATGKVVATIKV 76 (369)
T ss_dssp GEEEEEEGGGTEEEEEETTT-SEEEEEE---STTEEEEEE-TT-SSEEEEEE-------TTSEEEEEETTSSSEEEEEE-
T ss_pred cEEEEEecCCCEEEEEECCCCeEEEEEcC--CCCceeEEEecCCCCEEEEEc-------CCCeEEEEECCcccEEEEEec
Confidence 3443 3444 5588999999887766663 3444 3346678889888887 579999999999999999999
Q ss_pred CCceeEEEEeCC--eEEEE--ECCEEEEEEcCCcEEEEEEeccCCCC-----ceEEEeeCCCceEEEeecCCCCcEEEEe
Q 020784 175 RSEVRSVKLRRD--RIIVV--LEQKIFVYNFADLKLLHQIETIANPK-----GLCAVSQGVGSLVLVCPGLQKGQVRVEH 245 (321)
Q Consensus 175 ~~~v~~v~~~~~--~~~~~--~~~~I~iwd~~~~~~~~~l~~~~~~~-----~~~~~s~~~d~~~la~sGs~dg~V~i~d 245 (321)
.....+++++++ .++++ ..+.+.++|.++.+.++++.....+. ...++-..+.+..++++--..+.|.+.|
T Consensus 77 G~~~~~i~~s~DG~~~~v~n~~~~~v~v~D~~tle~v~~I~~~~~~~~~~~~Rv~aIv~s~~~~~fVv~lkd~~~I~vVd 156 (369)
T PF02239_consen 77 GGNPRGIAVSPDGKYVYVANYEPGTVSVIDAETLEPVKTIPTGGMPVDGPESRVAAIVASPGRPEFVVNLKDTGEIWVVD 156 (369)
T ss_dssp SSEEEEEEE--TTTEEEEEEEETTEEEEEETTT--EEEEEE--EE-TTTS---EEEEEE-SSSSEEEEEETTTTEEEEEE
T ss_pred CCCcceEEEcCCCCEEEEEecCCCceeEeccccccceeecccccccccccCCCceeEEecCCCCEEEEEEccCCeEEEEE
Confidence 888899999875 45554 35899999999999999987643222 3444433334343332345557787777
Q ss_pred eCCc-ceE-EeeccccceeEEEECCCCCEEEEEeC-CCcEEEEEEcCCCcEEEEEeCCCcce
Q 020784 246 YASK-RTK-FIMAHDSRIACFALTQDGQLLATSST-KGTLVRIFNTLDGTLLQEECCPSISA 304 (321)
Q Consensus 246 ~~~~-~~~-~l~~H~~~V~~vafspdg~~las~S~-Dgt~IrIWd~~tg~~i~~~~~g~~~~ 304 (321)
+... .+. .............|+|+|+||+.+.. ++. |-++|+++++++..+..|....
T Consensus 157 y~d~~~~~~~~i~~g~~~~D~~~dpdgry~~va~~~sn~-i~viD~~~~k~v~~i~~g~~p~ 217 (369)
T PF02239_consen 157 YSDPKNLKVTTIKVGRFPHDGGFDPDGRYFLVAANGSNK-IAVIDTKTGKLVALIDTGKKPH 217 (369)
T ss_dssp TTTSSCEEEEEEE--TTEEEEEE-TTSSEEEEEEGGGTE-EEEEETTTTEEEEEEE-SSSBE
T ss_pred eccccccceeeecccccccccccCcccceeeecccccce-eEEEeeccceEEEEeecccccc
Confidence 6553 232 33334556778999999998776544 445 9999999999998887765543
No 219
>KOG1445 consensus Tumor-specific antigen (contains WD repeats) [Cytoskeleton]
Probab=99.07 E-value=1.3e-09 Score=102.27 Aligned_cols=196 Identities=13% Similarity=0.164 Sum_probs=123.0
Q ss_pred CCeEEEEEcC-CCCEEEEEcCCc-EEEEEecCCce-------eEEeeeecCCceEEEEEec-CCCeEEEEeCCCCCCCCC
Q 020784 86 PTLLHISFNQ-DHGCFAAGTDHG-FRIYNCDPFRE-------IFRRDFERGGGIGVVEMLF-RCNILALVGGGPDPQYPL 155 (321)
Q Consensus 86 ~~V~~v~fs~-dg~~lasg~~~g-v~vw~~~~~~~-------~~~~~~~~~~~v~~v~~~~-~~~~~~~~sg~~~~~~~d 155 (321)
..|+.+.|+| |...||+++++| |+||.+...+. ...... |...|..+.|++ ..+.+++++ .|
T Consensus 628 t~vtDl~WdPFD~~rLAVa~ddg~i~lWr~~a~gl~e~~~tPe~~lt~-h~eKI~slRfHPLAadvLa~as-------yd 699 (1012)
T KOG1445|consen 628 TLVTDLHWDPFDDERLAVATDDGQINLWRLTANGLPENEMTPEKILTI-HGEKITSLRFHPLAADVLAVAS-------YD 699 (1012)
T ss_pred ceeeecccCCCChHHeeecccCceEEEEEeccCCCCcccCCcceeeec-ccceEEEEEecchhhhHhhhhh-------cc
Confidence 4789999999 778899999988 67999865432 112222 567788888876 345666666 68
Q ss_pred CcEEEEeCCCCcEEEEEeeC-CceeEEEEeCCeE---EEEECCEEEEEEcCCcEEEEEEeccCCCCc--eEEEeeCCCce
Q 020784 156 NKVMIWDDHQSRCIGELSFR-SEVRSVKLRRDRI---IVVLEQKIFVYNFADLKLLHQIETIANPKG--LCAVSQGVGSL 229 (321)
Q Consensus 156 ~~v~iWD~~~~~~~~~~~~~-~~v~~v~~~~~~~---~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~--~~~~s~~~d~~ 229 (321)
-+|++||++++.....+..+ ..|..++|++++- .+|-|++|++|+-+..+. -+.....+++ -..+-+..|+.
T Consensus 700 ~Ti~lWDl~~~~~~~~l~gHtdqIf~~AWSpdGr~~AtVcKDg~~rVy~Prs~e~--pv~Eg~gpvgtRgARi~wacdgr 777 (1012)
T KOG1445|consen 700 STIELWDLANAKLYSRLVGHTDQIFGIAWSPDGRRIATVCKDGTLRVYEPRSREQ--PVYEGKGPVGTRGARILWACDGR 777 (1012)
T ss_pred ceeeeeehhhhhhhheeccCcCceeEEEECCCCcceeeeecCceEEEeCCCCCCC--ccccCCCCccCcceeEEEEecCc
Confidence 99999999998877666655 5899999998753 345678999999976543 2222222222 12233333456
Q ss_pred EEEeecCC---CCcEEEEeeCC---cceEEeeccccceeEE-EECCC-CCEEEEEeCCCcEEEEEEcCCCc
Q 020784 230 VLVCPGLQ---KGQVRVEHYAS---KRTKFIMAHDSRIACF-ALTQD-GQLLATSSTKGTLVRIFNTLDGT 292 (321)
Q Consensus 230 ~la~sGs~---dg~V~i~d~~~---~~~~~l~~H~~~V~~v-afspd-g~~las~S~Dgt~IrIWd~~tg~ 292 (321)
+++++|.. ...|.+|+.+. ..+.+..--..+-.-| .+.+| +.+|+||=.|.. |.+|.+-...
T Consensus 778 ~viv~Gfdk~SeRQv~~Y~Aq~l~~~pl~t~~lDvaps~LvP~YD~Ds~~lfltGKGD~~-v~~yEv~~es 847 (1012)
T KOG1445|consen 778 IVIVVGFDKSSERQVQMYDAQTLDLRPLYTQVLDVAPSPLVPHYDYDSNVLFLTGKGDRF-VNMYEVIYES 847 (1012)
T ss_pred EEEEecccccchhhhhhhhhhhccCCcceeeeecccCccccccccCCCceEEEecCCCce-EEEEEecCCC
Confidence 77666753 33566676543 2333221111111111 23344 457888877888 9999876543
No 220
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=99.06 E-value=1.5e-06 Score=80.13 Aligned_cols=223 Identities=16% Similarity=0.146 Sum_probs=136.9
Q ss_pred CeEEEEEcCCCCEEEEEcCC-----cEEEEEecCC--ceeEEeeee-cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcE
Q 020784 87 TLLHISFNQDHGCFAAGTDH-----GFRIYNCDPF--REIFRRDFE-RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~~-----gv~vw~~~~~--~~~~~~~~~-~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
.-..+++++++++|.+.... +|..|.++.. +........ .+..-..+++.++++.++++.- .+++|
T Consensus 38 ~Ps~l~~~~~~~~LY~~~e~~~~~g~v~~~~i~~~~g~L~~~~~~~~~g~~p~~i~~~~~g~~l~vany------~~g~v 111 (345)
T PF10282_consen 38 NPSWLAVSPDGRRLYVVNEGSGDSGGVSSYRIDPDTGTLTLLNSVPSGGSSPCHIAVDPDGRFLYVANY------GGGSV 111 (345)
T ss_dssp SECCEEE-TTSSEEEEEETTSSTTTEEEEEEEETTTTEEEEEEEEEESSSCEEEEEECTTSSEEEEEET------TTTEE
T ss_pred CCceEEEEeCCCEEEEEEccccCCCCEEEEEECCCcceeEEeeeeccCCCCcEEEEEecCCCEEEEEEc------cCCeE
Confidence 44568899999999887652 4778888764 332222221 2445567788889998888763 46899
Q ss_pred EEEeCCC-CcEEEE---Eee-----------CCceeEEEEeCC--eEEEEE--CCEEEEEEcCCcE--E--EEEEeccCC
Q 020784 159 MIWDDHQ-SRCIGE---LSF-----------RSEVRSVKLRRD--RIIVVL--EQKIFVYNFADLK--L--LHQIETIAN 215 (321)
Q Consensus 159 ~iWD~~~-~~~~~~---~~~-----------~~~v~~v~~~~~--~~~~~~--~~~I~iwd~~~~~--~--~~~l~~~~~ 215 (321)
.++++.. +..... +.+ ...+.++.++++ .++++. .+.|++|++.... + ...+.....
T Consensus 112 ~v~~l~~~g~l~~~~~~~~~~g~g~~~~rq~~~h~H~v~~~pdg~~v~v~dlG~D~v~~~~~~~~~~~l~~~~~~~~~~G 191 (345)
T PF10282_consen 112 SVFPLDDDGSLGEVVQTVRHEGSGPNPDRQEGPHPHQVVFSPDGRFVYVPDLGADRVYVYDIDDDTGKLTPVDSIKVPPG 191 (345)
T ss_dssp EEEEECTTSEEEEEEEEEESEEEESSTTTTSSTCEEEEEE-TTSSEEEEEETTTTEEEEEEE-TTS-TEEEEEEEECSTT
T ss_pred EEEEccCCcccceeeeecccCCCCCcccccccccceeEEECCCCCEEEEEecCCCEEEEEEEeCCCceEEEeeccccccC
Confidence 9999986 433222 211 235778889876 455553 3699999996543 3 233332211
Q ss_pred CC-ceEEEeeCCCceEEEeecCCCCcEEEEeeC--CcceEE---ee----cc--ccceeEEEECCCCCEEEEEeC-CCcE
Q 020784 216 PK-GLCAVSQGVGSLVLVCPGLQKGQVRVEHYA--SKRTKF---IM----AH--DSRIACFALTQDGQLLATSST-KGTL 282 (321)
Q Consensus 216 ~~-~~~~~s~~~d~~~la~sGs~dg~V~i~d~~--~~~~~~---l~----~H--~~~V~~vafspdg~~las~S~-Dgt~ 282 (321)
.. .-+.|++ ++.++.+....++.|.++++. .+.+.. +. +. ......|+++|||++|..+.. .++
T Consensus 192 ~GPRh~~f~p--dg~~~Yv~~e~s~~v~v~~~~~~~g~~~~~~~~~~~~~~~~~~~~~~~i~ispdg~~lyvsnr~~~s- 268 (345)
T PF10282_consen 192 SGPRHLAFSP--DGKYAYVVNELSNTVSVFDYDPSDGSLTEIQTISTLPEGFTGENAPAEIAISPDGRFLYVSNRGSNS- 268 (345)
T ss_dssp SSEEEEEE-T--TSSEEEEEETTTTEEEEEEEETTTTEEEEEEEEESCETTSCSSSSEEEEEE-TTSSEEEEEECTTTE-
T ss_pred CCCcEEEEcC--CcCEEEEecCCCCcEEEEeecccCCceeEEEEeeeccccccccCCceeEEEecCCCEEEEEeccCCE-
Confidence 11 2345555 445554457888899997776 333221 11 11 125889999999998766554 555
Q ss_pred EEEEEc--CCCc--EEEEEeC-CCcceeEEEeecCceEEEe
Q 020784 283 VRIFNT--LDGT--LLQEECC-PSISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 283 IrIWd~--~tg~--~i~~~~~-g~~~~~~~~s~d~~~la~~ 318 (321)
|-+|++ .+|+ .+..+.. |.....+.+++||+||+|+
T Consensus 269 I~vf~~d~~~g~l~~~~~~~~~G~~Pr~~~~s~~g~~l~Va 309 (345)
T PF10282_consen 269 ISVFDLDPATGTLTLVQTVPTGGKFPRHFAFSPDGRYLYVA 309 (345)
T ss_dssp EEEEEECTTTTTEEEEEEEEESSSSEEEEEE-TTSSEEEEE
T ss_pred EEEEEEecCCCceEEEEEEeCCCCCccEEEEeCCCCEEEEE
Confidence 999999 3454 3455554 4546677899999999986
No 221
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=99.06 E-value=9.4e-08 Score=90.15 Aligned_cols=203 Identities=10% Similarity=0.056 Sum_probs=124.7
Q ss_pred CCCCeEEEEEcCCCCEEEEEcC----CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 84 PPPTLLHISFNQDHGCFAAGTD----HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~----~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
+...+.+.+|+|||++||.+.. ..+.+||+.+++......+ .+......|+++++.+++..... ....|.
T Consensus 188 ~~~~~~~p~~Spdg~~la~~~~~~~~~~i~v~d~~~g~~~~~~~~--~~~~~~~~~spDg~~l~~~~~~~----~~~~i~ 261 (417)
T TIGR02800 188 SREPILSPAWSPDGQKLAYVSFESGKPEIYVQDLATGQREKVASF--PGMNGAPAFSPDGSKLAVSLSKD----GNPDIY 261 (417)
T ss_pred CCCceecccCCCCCCEEEEEEcCCCCcEEEEEECCCCCEEEeecC--CCCccceEECCCCCEEEEEECCC----CCccEE
Confidence 3346889999999999997654 2377999988755433332 44556678899998887665321 235799
Q ss_pred EEeCCCCcEEEEEeeCCceeEEEEeCC--eEEEEEC----CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEe
Q 020784 160 IWDDHQSRCIGELSFRSEVRSVKLRRD--RIIVVLE----QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVC 233 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~~~v~~v~~~~~--~~~~~~~----~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~ 233 (321)
+||+.++.......+........|+++ .++.+.+ ..|.++|+.+++. ..+..+........+++ ++..+++
T Consensus 262 ~~d~~~~~~~~l~~~~~~~~~~~~s~dg~~l~~~s~~~g~~~iy~~d~~~~~~-~~l~~~~~~~~~~~~sp--dg~~i~~ 338 (417)
T TIGR02800 262 VMDLDGKQLTRLTNGPGIDTEPSWSPDGKSIAFTSDRGGSPQIYMMDADGGEV-RRLTFRGGYNASPSWSP--DGDLIAF 338 (417)
T ss_pred EEECCCCCEEECCCCCCCCCCEEECCCCCEEEEEECCCCCceEEEEECCCCCE-EEeecCCCCccCeEECC--CCCEEEE
Confidence 999988765433333333445667664 4555543 2788888877654 33433333333445555 4566665
Q ss_pred ecCCCC--cEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCc--EEEEEEcCCCcEEEEE
Q 020784 234 PGLQKG--QVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGT--LVRIFNTLDGTLLQEE 297 (321)
Q Consensus 234 sGs~dg--~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt--~IrIWd~~tg~~i~~~ 297 (321)
+....+ .|.+++..++....+..+ ......+|+|||++|+..+.++. .+.+.+ .+|+....+
T Consensus 339 ~~~~~~~~~i~~~d~~~~~~~~l~~~-~~~~~p~~spdg~~l~~~~~~~~~~~l~~~~-~~g~~~~~~ 404 (417)
T TIGR02800 339 VHREGGGFNIAVMDLDGGGERVLTDT-GLDESPSFAPNGRMILYATTRGGRGVLGLVS-TDGRFRARL 404 (417)
T ss_pred EEccCCceEEEEEeCCCCCeEEccCC-CCCCCceECCCCCEEEEEEeCCCcEEEEEEE-CCCceeeEC
Confidence 444333 556688776655544433 23456789999999888877653 244444 345554444
No 222
>PF02239 Cytochrom_D1: Cytochrome D1 heme domain; PDB: 1NNO_B 1HZU_A 1N15_B 1N50_A 1GJQ_A 1BL9_B 1NIR_B 1N90_B 1HZV_A 1AOQ_A ....
Probab=99.04 E-value=6.1e-08 Score=89.85 Aligned_cols=216 Identities=11% Similarity=0.075 Sum_probs=123.7
Q ss_pred EEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCc
Q 020784 89 LHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSR 167 (321)
Q Consensus 89 ~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~ 167 (321)
..+.|++||+++.+.+.++ +.++|+.+.+.+..... +..-..+++++++++++++.. .++++.|+|.++.+
T Consensus 40 ~~~~~s~Dgr~~yv~~rdg~vsviD~~~~~~v~~i~~--G~~~~~i~~s~DG~~~~v~n~------~~~~v~v~D~~tle 111 (369)
T PF02239_consen 40 AGLKFSPDGRYLYVANRDGTVSVIDLATGKVVATIKV--GGNPRGIAVSPDGKYVYVANY------EPGTVSVIDAETLE 111 (369)
T ss_dssp EEEE-TT-SSEEEEEETTSEEEEEETTSSSEEEEEE---SSEEEEEEE--TTTEEEEEEE------ETTEEEEEETTT--
T ss_pred eEEEecCCCCEEEEEcCCCeEEEEECCcccEEEEEec--CCCcceEEEcCCCCEEEEEec------CCCceeEecccccc
Confidence 3467999999988777655 77999999998766664 566777899999999887762 46999999999999
Q ss_pred EEEEEeeCC--------ceeEEEEeCC--eEEEEEC--CEEEEEEcCCcEEE--EEEeccCCCCceEEEeeCCCceEEEe
Q 020784 168 CIGELSFRS--------EVRSVKLRRD--RIIVVLE--QKIFVYNFADLKLL--HQIETIANPKGLCAVSQGVGSLVLVC 233 (321)
Q Consensus 168 ~~~~~~~~~--------~v~~v~~~~~--~~~~~~~--~~I~iwd~~~~~~~--~~l~~~~~~~~~~~~s~~~d~~~la~ 233 (321)
.+..+.... .+.++...+. .++++.. +.|-+.|..+.+.+ ..+.... .......++++.++.+
T Consensus 112 ~v~~I~~~~~~~~~~~~Rv~aIv~s~~~~~fVv~lkd~~~I~vVdy~d~~~~~~~~i~~g~---~~~D~~~dpdgry~~v 188 (369)
T PF02239_consen 112 PVKTIPTGGMPVDGPESRVAAIVASPGRPEFVVNLKDTGEIWVVDYSDPKNLKVTTIKVGR---FPHDGGFDPDGRYFLV 188 (369)
T ss_dssp EEEEEE--EE-TTTS---EEEEEE-SSSSEEEEEETTTTEEEEEETTTSSCEEEEEEE--T---TEEEEEE-TTSSEEEE
T ss_pred ceeecccccccccccCCCceeEEecCCCCEEEEEEccCCeEEEEEeccccccceeeecccc---cccccccCcccceeee
Confidence 888776432 3455554332 3444443 57777787654322 3333221 2334444555554433
Q ss_pred ecCCCCcEEEEeeCCcc--------------------------------------------------------eEEeecc
Q 020784 234 PGLQKGQVRVEHYASKR--------------------------------------------------------TKFIMAH 257 (321)
Q Consensus 234 sGs~dg~V~i~d~~~~~--------------------------------------------------------~~~l~~H 257 (321)
....+..|-++|..++. +.++...
T Consensus 189 a~~~sn~i~viD~~~~k~v~~i~~g~~p~~~~~~~~php~~g~vw~~~~~~~~~~~~ig~~~v~v~d~~~wkvv~~I~~~ 268 (369)
T PF02239_consen 189 AANGSNKIAVIDTKTGKLVALIDTGKKPHPGPGANFPHPGFGPVWATSGLGYFAIPLIGTDPVSVHDDYAWKVVKTIPTQ 268 (369)
T ss_dssp EEGGGTEEEEEETTTTEEEEEEE-SSSBEETTEEEEEETTTEEEEEEEBSSSSEEEEEE--TTT-STTTBTSEEEEEE-S
T ss_pred cccccceeEEEeeccceEEEEeeccccccccccccccCCCcceEEeeccccceecccccCCccccchhhcCeEEEEEECC
Confidence 22333344444332211 1122222
Q ss_pred ccceeEEEECCCCCEEEEE----eCCCcEEEEEEcCCCcEEEEEeCCCc--ceeEEEeecCceEEE
Q 020784 258 DSRIACFALTQDGQLLATS----STKGTLVRIFNTLDGTLLQEECCPSI--SAQSGLWLSSAWLRV 317 (321)
Q Consensus 258 ~~~V~~vafspdg~~las~----S~Dgt~IrIWd~~tg~~i~~~~~g~~--~~~~~~s~d~~~la~ 317 (321)
... .-+.-+|+++++... ...++ |.|+|.++.+.++++..+.. .....|+.||+++-+
T Consensus 269 G~g-lFi~thP~s~~vwvd~~~~~~~~~-v~viD~~tl~~~~~i~~~~~~~~~h~ef~~dG~~v~v 332 (369)
T PF02239_consen 269 GGG-LFIKTHPDSRYVWVDTFLNPDADT-VQVIDKKTLKVVKTITPGPGKRVVHMEFNPDGKEVWV 332 (369)
T ss_dssp SSS---EE--TT-SEEEEE-TT-SSHT--EEEEECCGTEEEE-HHHHHT--EEEEEE-TTSSEEEE
T ss_pred CCc-ceeecCCCCccEEeeccCCCCCce-EEEEECcCcceeEEEeccCCCcEeccEECCCCCEEEE
Confidence 222 567889999999887 44466 99999999999988865444 556688999986544
No 223
>KOG0882 consensus Cyclophilin-related peptidyl-prolyl cis-trans isomerase [Posttranslational modification, protein turnover, chaperones]
Probab=99.04 E-value=8.6e-10 Score=99.76 Aligned_cols=210 Identities=18% Similarity=0.096 Sum_probs=149.9
Q ss_pred CcccCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecC-CceeEEeeee-cCCceEEEEEecCCCeEEEEeCCCCCCCC
Q 020784 78 ESTSSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDP-FREIFRRDFE-RGGGIGVVEMLFRCNILALVGGGPDPQYP 154 (321)
Q Consensus 78 ~~~~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~-~~~~~~~~~~-~~~~v~~v~~~~~~~~~~~~sg~~~~~~~ 154 (321)
|..+.+|+..|+.|.-+- .+++.+++-+| ++.|.-.. ....+..+++ |-+.+..++.+.++.++++++. .
T Consensus 2 yeksymhrd~i~hv~~tk-a~fiiqASlDGh~KFWkKs~isGvEfVKhFraHL~~I~sl~~S~dg~L~~Sv~d------~ 74 (558)
T KOG0882|consen 2 YEKSYMHRDVITHVFPTK-AKFIIQASLDGHKKFWKKSRISGVEFVKHFRAHLGVILSLAVSYDGWLFRSVED------P 74 (558)
T ss_pred cchhhcccceeeeEeeeh-hheEEeeecchhhhhcCCCCccceeehhhhHHHHHHHHhhhccccceeEeeccC------c
Confidence 567889999999887654 56788888776 67998655 4455555553 5566677777777776666551 2
Q ss_pred CCcEEEEeCCCCcEEEEEeeCCceeEEEEeC---C---eEEEEE--CCEEEEEEcCC-c-EEEEEEeccCCCCceEEEee
Q 020784 155 LNKVMIWDDHQSRCIGELSFRSEVRSVKLRR---D---RIIVVL--EQKIFVYNFAD-L-KLLHQIETIANPKGLCAVSQ 224 (321)
Q Consensus 155 d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~---~---~~~~~~--~~~I~iwd~~~-~-~~~~~l~~~~~~~~~~~~s~ 224 (321)
|+.+|++|+++...+..++...-+..++|.. + .+++.. ++.|.++|-.. . +....-..|.+++.+..+.+
T Consensus 75 Dhs~KvfDvEn~DminmiKL~~lPg~a~wv~skGd~~s~IAVs~~~sg~i~VvD~~~d~~q~~~fkklH~sPV~~i~y~q 154 (558)
T KOG0882|consen 75 DHSVKVFDVENFDMINMIKLVDLPGFAEWVTSKGDKISLIAVSLFKSGKIFVVDGFGDFCQDGYFKKLHFSPVKKIRYNQ 154 (558)
T ss_pred ccceeEEEeeccchhhhcccccCCCceEEecCCCCeeeeEEeecccCCCcEEECCcCCcCccceecccccCceEEEEeec
Confidence 7999999999888777777666555666542 1 233332 46999999753 2 33334455778888888887
Q ss_pred CCCceEEEeecCCCCcEEEEeeCC------cc----------eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEc
Q 020784 225 GVGSLVLVCPGLQKGQVRVEHYAS------KR----------TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 225 ~~d~~~la~sGs~dg~V~i~d~~~------~~----------~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~ 288 (321)
.+|. ++ |+...|+|..|.... .. +..+...++...++.|+|+|..+++-+.|.+ ||+|++
T Consensus 155 a~Ds--~v-SiD~~gmVEyWs~e~~~qfPr~~l~~~~K~eTdLy~f~K~Kt~pts~Efsp~g~qistl~~Drk-VR~F~~ 230 (558)
T KOG0882|consen 155 AGDS--AV-SIDISGMVEYWSAEGPFQFPRTNLNFELKHETDLYGFPKAKTEPTSFEFSPDGAQISTLNPDRK-VRGFVF 230 (558)
T ss_pred cccc--ee-eccccceeEeecCCCcccCccccccccccccchhhcccccccCccceEEccccCcccccCcccE-EEEEEe
Confidence 7653 33 578889999998652 11 1124455778999999999999999999999 999999
Q ss_pred CCCcEEEEEe
Q 020784 289 LDGTLLQEEC 298 (321)
Q Consensus 289 ~tg~~i~~~~ 298 (321)
++|++++.++
T Consensus 231 KtGklvqeiD 240 (558)
T KOG0882|consen 231 KTGKLVQEID 240 (558)
T ss_pred ccchhhhhhh
Confidence 9999887664
No 224
>PRK00178 tolB translocation protein TolB; Provisional
Probab=99.03 E-value=1.5e-07 Score=89.40 Aligned_cols=203 Identities=13% Similarity=0.079 Sum_probs=123.5
Q ss_pred CCCCeEEEEEcCCCCEEEEEcC-C---cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 84 PPPTLLHISFNQDHGCFAAGTD-H---GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~-~---gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
+...+...+|+|||++|+..+. + .+.+|++++++....... .+......|+++++.+++..... .+..|.
T Consensus 197 ~~~~~~~p~wSpDG~~la~~s~~~~~~~l~~~~l~~g~~~~l~~~--~g~~~~~~~SpDG~~la~~~~~~----g~~~Iy 270 (430)
T PRK00178 197 SREPILSPRWSPDGKRIAYVSFEQKRPRIFVQNLDTGRREQITNF--EGLNGAPAWSPDGSKLAFVLSKD----GNPEIY 270 (430)
T ss_pred CCCceeeeeECCCCCEEEEEEcCCCCCEEEEEECCCCCEEEccCC--CCCcCCeEECCCCCEEEEEEccC----CCceEE
Confidence 4457899999999999987654 2 266888887765332222 34445678899999888655321 124688
Q ss_pred EEeCCCCcEEEEEeeCCceeEEEEeCC--eEEEEEC----CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEe
Q 020784 160 IWDDHQSRCIGELSFRSEVRSVKLRRD--RIIVVLE----QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVC 233 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~~~v~~v~~~~~--~~~~~~~----~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~ 233 (321)
+||+++++...............|+++ .++...+ ..|.++|+.+++.. .+...........+++ |+..+++
T Consensus 271 ~~d~~~~~~~~lt~~~~~~~~~~~spDg~~i~f~s~~~g~~~iy~~d~~~g~~~-~lt~~~~~~~~~~~Sp--dg~~i~~ 347 (430)
T PRK00178 271 VMDLASRQLSRVTNHPAIDTEPFWGKDGRTLYFTSDRGGKPQIYKVNVNGGRAE-RVTFVGNYNARPRLSA--DGKTLVM 347 (430)
T ss_pred EEECCCCCeEEcccCCCCcCCeEECCCCCEEEEEECCCCCceEEEEECCCCCEE-EeecCCCCccceEECC--CCCEEEE
Confidence 999998875443333334556778765 4555543 27888888777643 3322222222345555 4566766
Q ss_pred ecCCCC--cEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCC--cEEEEEEcCCCcEEEEE
Q 020784 234 PGLQKG--QVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKG--TLVRIFNTLDGTLLQEE 297 (321)
Q Consensus 234 sGs~dg--~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dg--t~IrIWd~~tg~~i~~~ 297 (321)
....+| .|.++|+.++....+.. ........|+|||++++-.+.++ ..|.++++. |...+.+
T Consensus 348 ~~~~~~~~~l~~~dl~tg~~~~lt~-~~~~~~p~~spdg~~i~~~~~~~g~~~l~~~~~~-g~~~~~l 413 (430)
T PRK00178 348 VHRQDGNFHVAAQDLQRGSVRILTD-TSLDESPSVAPNGTMLIYATRQQGRGVLMLVSIN-GRVRLPL 413 (430)
T ss_pred EEccCCceEEEEEECCCCCEEEccC-CCCCCCceECCCCCEEEEEEecCCceEEEEEECC-CCceEEC
Confidence 554455 35568887766555542 22334568999999988776543 225566664 4443444
No 225
>PRK04792 tolB translocation protein TolB; Provisional
Probab=99.03 E-value=8.8e-08 Score=91.32 Aligned_cols=203 Identities=13% Similarity=0.088 Sum_probs=121.2
Q ss_pred CCCeEEEEEcCCCCEEEEEcC-Cc---EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 85 PPTLLHISFNQDHGCFAAGTD-HG---FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 85 ~~~V~~v~fs~dg~~lasg~~-~g---v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
...+.+.+|+|||++|+..+. ++ +.+||+.+++......+ .+......|+++++.++++...+ ....|.+
T Consensus 217 ~~~~~~p~wSPDG~~La~~s~~~g~~~L~~~dl~tg~~~~lt~~--~g~~~~~~wSPDG~~La~~~~~~----g~~~Iy~ 290 (448)
T PRK04792 217 PEPLMSPAWSPDGRKLAYVSFENRKAEIFVQDIYTQVREKVTSF--PGINGAPRFSPDGKKLALVLSKD----GQPEIYV 290 (448)
T ss_pred CCcccCceECCCCCEEEEEEecCCCcEEEEEECCCCCeEEecCC--CCCcCCeeECCCCCEEEEEEeCC----CCeEEEE
Confidence 346788999999999987654 22 56778877654322222 23344568899999888765321 1235888
Q ss_pred EeCCCCcEEEEEeeCCceeEEEEeCC--eEEEEEC----CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEee
Q 020784 161 WDDHQSRCIGELSFRSEVRSVKLRRD--RIIVVLE----QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCP 234 (321)
Q Consensus 161 WD~~~~~~~~~~~~~~~v~~v~~~~~--~~~~~~~----~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~s 234 (321)
||+.+++...............|+++ .++...+ ..|.++|+.+++.. .+..........++++ |+..++++
T Consensus 291 ~dl~tg~~~~lt~~~~~~~~p~wSpDG~~I~f~s~~~g~~~Iy~~dl~~g~~~-~Lt~~g~~~~~~~~Sp--DG~~l~~~ 367 (448)
T PRK04792 291 VDIATKALTRITRHRAIDTEPSWHPDGKSLIFTSERGGKPQIYRVNLASGKVS-RLTFEGEQNLGGSITP--DGRSMIMV 367 (448)
T ss_pred EECCCCCeEECccCCCCccceEECCCCCEEEEEECCCCCceEEEEECCCCCEE-EEecCCCCCcCeeECC--CCCEEEEE
Confidence 89988765433333334566788876 3444443 26778888776643 3322212222345555 44666665
Q ss_pred cCCCCcEEE--EeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCc--EEEEEEcCCCcEEEEEe
Q 020784 235 GLQKGQVRV--EHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGT--LVRIFNTLDGTLLQEEC 298 (321)
Q Consensus 235 Gs~dg~V~i--~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt--~IrIWd~~tg~~i~~~~ 298 (321)
+..++...| +|+.++....+.... .....+|+|||+.|+-.+.++. .+.++++ +|+..+.+.
T Consensus 368 ~~~~g~~~I~~~dl~~g~~~~lt~~~-~d~~ps~spdG~~I~~~~~~~g~~~l~~~~~-~G~~~~~l~ 433 (448)
T PRK04792 368 NRTNGKFNIARQDLETGAMQVLTSTR-LDESPSVAPNGTMVIYSTTYQGKQVLAAVSI-DGRFKARLP 433 (448)
T ss_pred EecCCceEEEEEECCCCCeEEccCCC-CCCCceECCCCCEEEEEEecCCceEEEEEEC-CCCceEECc
Confidence 555665555 666666555444331 2234589999998877665432 2566676 566666564
No 226
>KOG0642 consensus Cell-cycle nuclear protein, contains WD-40 repeats [Cell cycle control, cell division, chromosome partitioning]
Probab=99.01 E-value=6.5e-09 Score=96.37 Aligned_cols=224 Identities=11% Similarity=0.104 Sum_probs=140.3
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecC------CceeEEeeee-cCCceEEEEEecCCCeEEEEeCCCCCC
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDP------FREIFRRDFE-RGGGIGVVEMLFRCNILALVGGGPDPQ 152 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~------~~~~~~~~~~-~~~~v~~v~~~~~~~~~~~~sg~~~~~ 152 (321)
.+.|-..|+.+.|.+-.-.|++++.++ +.+|+++. ...+-.++|+ |.++|-++++...+..+..++
T Consensus 290 l~s~~d~ir~l~~~~sep~lit~sed~~lk~WnLqk~~~s~~~~~epi~tfraH~gPVl~v~v~~n~~~~ysgg------ 363 (577)
T KOG0642|consen 290 LRSHDDCIRALAFHPSEPVLITASEDGTLKLWNLQKAKKSAEKDVEPILTFRAHEGPVLCVVVPSNGEHCYSGG------ 363 (577)
T ss_pred eecchhhhhhhhcCCCCCeEEEeccccchhhhhhcccCCccccceeeeEEEecccCceEEEEecCCceEEEeec------
Confidence 356777899999999999999999977 56999832 1122233443 899999999988887777666
Q ss_pred CCCCcEEEEeCC------CCc----EEEEEee-CCceeEEEEeC--CeEEEE-ECCEEEEEEcCCcEEEEEEeccCCCC-
Q 020784 153 YPLNKVMIWDDH------QSR----CIGELSF-RSEVRSVKLRR--DRIIVV-LEQKIFVYNFADLKLLHQIETIANPK- 217 (321)
Q Consensus 153 ~~d~~v~iWD~~------~~~----~~~~~~~-~~~v~~v~~~~--~~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~- 217 (321)
-||+|+.|++- ..- ....+.+ ...|..+.++. ++++.| .|+++|.|+...... .+|.......
T Consensus 364 -~Dg~I~~w~~p~n~dp~ds~dp~vl~~~l~Ghtdavw~l~~s~~~~~Llscs~DgTvr~w~~~~~~~-~~f~~~~e~g~ 441 (577)
T KOG0642|consen 364 -IDGTIRCWNLPPNQDPDDSYDPSVLSGTLLGHTDAVWLLALSSTKDRLLSCSSDGTVRLWEPTEESP-CTFGEPKEHGY 441 (577)
T ss_pred -cCceeeeeccCCCCCcccccCcchhccceeccccceeeeeecccccceeeecCCceEEeeccCCcCc-cccCCccccCC
Confidence 78999999542 111 1122333 34677777764 567777 468999999876655 3443322111
Q ss_pred -ceEEE-eeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeec-------cccceeEEEECCCCCEEEEEeCCCcEEEEEE
Q 020784 218 -GLCAV-SQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMA-------HDSRIACFALTQDGQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 218 -~~~~~-s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~-------H~~~V~~vafspdg~~las~S~Dgt~IrIWd 287 (321)
..+++ +..+ ....+ ...-|.--++++.... +..+.. -...+.-|..+|.+.+..++-+|++ ||++|
T Consensus 442 Plsvd~~ss~~--a~~~~-s~~~~~~~~~~~ev~s~~~~~~s~~~~~~~~~~~in~vVs~~~~~~~~~~hed~~-Ir~~d 517 (577)
T KOG0642|consen 442 PLSVDRTSSRP--AHSLA-SFRFGYTSIDDMEVVSDLLIFESSASPGPRRYPQINKVVSHPTADITFTAHEDRS-IRFFD 517 (577)
T ss_pred cceEeeccchh--Hhhhh-hcccccccchhhhhhhheeeccccCCCcccccCccceEEecCCCCeeEecccCCc-eeccc
Confidence 12222 2221 11111 1111222223333222 222211 1234778889999999999999999 99999
Q ss_pred cCCCcEEEEEeCCCccee--EEEeecCceEEE
Q 020784 288 TLDGTLLQEECCPSISAQ--SGLWLSSAWLRV 317 (321)
Q Consensus 288 ~~tg~~i~~~~~g~~~~~--~~~s~d~~~la~ 317 (321)
..+|+.++... .+.... +++.++|-||+.
T Consensus 518 n~~~~~l~s~~-a~~~svtslai~~ng~~l~s 548 (577)
T KOG0642|consen 518 NKTGKILHSMV-AHKDSVTSLAIDPNGPYLMS 548 (577)
T ss_pred ccccccchhee-eccceecceeecCCCceEEe
Confidence 99999998874 344333 355677777654
No 227
>KOG0290 consensus Conserved WD40 repeat-containing protein AN11 [Function unknown]
Probab=99.01 E-value=6.9e-08 Score=83.20 Aligned_cols=192 Identities=8% Similarity=0.040 Sum_probs=133.4
Q ss_pred CCCCCCeEEEEEcC-CCCEEEEEcCCcE-EEEEecCCce--eEEeeeecCCceEEEEEecCC-CeEEEEeCCCCCCCCCC
Q 020784 82 SSPPPTLLHISFNQ-DHGCFAAGTDHGF-RIYNCDPFRE--IFRRDFERGGGIGVVEMLFRC-NILALVGGGPDPQYPLN 156 (321)
Q Consensus 82 ~~~~~~V~~v~fs~-dg~~lasg~~~gv-~vw~~~~~~~--~~~~~~~~~~~v~~v~~~~~~-~~~~~~sg~~~~~~~d~ 156 (321)
..+.+++++..|+. |-++|.+.+-|+. .|||++++.. +.+.-..|++.|..++|...+ +.+|.++ .||
T Consensus 147 s~~~aPlTSFDWne~dp~~igtSSiDTTCTiWdie~~~~~~vkTQLIAHDKEV~DIaf~~~s~~~FASvg-------aDG 219 (364)
T KOG0290|consen 147 SEFCAPLTSFDWNEVDPNLIGTSSIDTTCTIWDIETGVSGTVKTQLIAHDKEVYDIAFLKGSRDVFASVG-------ADG 219 (364)
T ss_pred cccCCcccccccccCCcceeEeecccCeEEEEEEeeccccceeeEEEecCcceeEEEeccCccceEEEec-------CCC
Confidence 44557999999997 5577778887774 4999998622 222222379999999997744 4556666 579
Q ss_pred cEEEEeCCCCcEEEEEee----CCceeEEEEeCCe---EEEE--ECCEEEEEEcCC-cEEEEEEeccCCCCceEEEeeCC
Q 020784 157 KVMIWDDHQSRCIGELSF----RSEVRSVKLRRDR---IIVV--LEQKIFVYNFAD-LKLLHQIETIANPKGLCAVSQGV 226 (321)
Q Consensus 157 ~v~iWD~~~~~~~~~~~~----~~~v~~v~~~~~~---~~~~--~~~~I~iwd~~~-~~~~~~l~~~~~~~~~~~~s~~~ 226 (321)
.||++|++..+-...+-. +.....++|+++. ++.. ....|.|.|++. ...+..+..|...+..+++.|+.
T Consensus 220 SvRmFDLR~leHSTIIYE~p~~~~pLlRLswnkqDpnymATf~~dS~~V~iLDiR~P~tpva~L~~H~a~VNgIaWaPhS 299 (364)
T KOG0290|consen 220 SVRMFDLRSLEHSTIIYEDPSPSTPLLRLSWNKQDPNYMATFAMDSNKVVILDIRVPCTPVARLRNHQASVNGIAWAPHS 299 (364)
T ss_pred cEEEEEecccccceEEecCCCCCCcceeeccCcCCchHHhhhhcCCceEEEEEecCCCcceehhhcCcccccceEecCCC
Confidence 999999987653322211 2356678887642 2222 246999999975 56678899999988888988876
Q ss_pred CceEEEeecCCCCcEEEEeeCCcce-------EEeeccccceeEEEECCC-CCEEEEEeCCCcEEEE
Q 020784 227 GSLVLVCPGLQKGQVRVEHYASKRT-------KFIMAHDSRIACFALTQD-GQLLATSSTKGTLVRI 285 (321)
Q Consensus 227 d~~~la~sGs~dg~V~i~d~~~~~~-------~~l~~H~~~V~~vafspd-g~~las~S~Dgt~IrI 285 (321)
. ..|+ +++.|-.+.|||+..... ..+. -.++|+.|.|++. +..+|.+. +++ +.|
T Consensus 300 ~-~hic-taGDD~qaliWDl~q~~~~~~~dPilay~-a~~EVNqi~Ws~~~~Dwiai~~-~kk-lei 361 (364)
T KOG0290|consen 300 S-SHIC-TAGDDCQALIWDLQQMPRENGEDPILAYT-AGGEVNQIQWSSSQPDWIAICF-GKK-LEI 361 (364)
T ss_pred C-ceee-ecCCcceEEEEecccccccCCCCchhhhh-ccceeeeeeecccCCCEEEEEe-cCe-eeE
Confidence 4 3454 588899999999875332 2233 5678999999954 67888776 544 444
No 228
>KOG0644 consensus Uncharacterized conserved protein, contains WD40 repeat and BROMO domains [General function prediction only]
Probab=99.00 E-value=5.1e-10 Score=107.74 Aligned_cols=199 Identities=15% Similarity=0.183 Sum_probs=137.8
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
-++|.+.|+.++.+.+..++|+++.|. |++|.+..+..+..... |.|.|..+++++.. ..+ .||+++
T Consensus 228 ~rGhs~ditdlavs~~n~~iaaaS~D~vIrvWrl~~~~pvsvLrg-htgavtaiafsP~~----sss-------~dgt~~ 295 (1113)
T KOG0644|consen 228 CRGHSGDITDLAVSSNNTMIAAASNDKVIRVWRLPDGAPVSVLRG-HTGAVTAIAFSPRA----SSS-------DDGTCR 295 (1113)
T ss_pred CCCCccccchhccchhhhhhhhcccCceEEEEecCCCchHHHHhc-cccceeeeccCccc----cCC-------CCCceE
Confidence 378999999999999999999999876 67999988776544443 78889988887754 222 689999
Q ss_pred EEeCC-C-------------CcEEEEEeeC--------------C---ceeEEEEeCCeEEEE--------------ECC
Q 020784 160 IWDDH-Q-------------SRCIGELSFR--------------S---EVRSVKLRRDRIIVV--------------LEQ 194 (321)
Q Consensus 160 iWD~~-~-------------~~~~~~~~~~--------------~---~v~~v~~~~~~~~~~--------------~~~ 194 (321)
+||.+ . +..+..+.+. . ..-.+.++...+..+ .+-
T Consensus 296 ~wd~r~~~~~y~prp~~~~~~~~~~s~~~~~~~~~f~Tgs~d~ea~n~e~~~l~~~~~~lif~t~ssd~~~~~~~ar~~~ 375 (1113)
T KOG0644|consen 296 IWDARLEPRIYVPRPLKFTEKDLVDSILFENNGDRFLTGSRDGEARNHEFEQLAWRSNLLIFVTRSSDLSSIVVTARNDH 375 (1113)
T ss_pred eccccccccccCCCCCCcccccceeeeeccccccccccccCCcccccchhhHhhhhccceEEEeccccccccceeeeeee
Confidence 99976 1 1111111100 0 011111221111111 224
Q ss_pred EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEE
Q 020784 195 KIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLL 273 (321)
Q Consensus 195 ~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~l 273 (321)
.+++|++.++++++.+.+|..+..++.+++-. ..++.+.+.||...|||...+. ++.+..-...+...+||+||+.+
T Consensus 376 ~~~vwnl~~g~l~H~l~ghsd~~yvLd~Hpfn--~ri~msag~dgst~iwdi~eg~pik~y~~gh~kl~d~kFSqdgts~ 453 (1113)
T KOG0644|consen 376 RLCVWNLYTGQLLHNLMGHSDEVYVLDVHPFN--PRIAMSAGYDGSTIIWDIWEGIPIKHYFIGHGKLVDGKFSQDGTSI 453 (1113)
T ss_pred EeeeeecccchhhhhhcccccceeeeeecCCC--cHhhhhccCCCceEeeecccCCcceeeecccceeeccccCCCCceE
Confidence 78999999999999999999998888887753 6677788999999999986543 44333335667788999999998
Q ss_pred EEEeCCCcEEEEEEcCCCcEE
Q 020784 274 ATSSTKGTLVRIFNTLDGTLL 294 (321)
Q Consensus 274 as~S~Dgt~IrIWd~~tg~~i 294 (321)
+..-.-|. +.|+.+..++-.
T Consensus 454 ~lsd~hgq-l~i~g~gqs~s~ 473 (1113)
T KOG0644|consen 454 ALSDDHGQ-LYILGTGQSKSQ 473 (1113)
T ss_pred ecCCCCCc-eEEeccCCCccc
Confidence 85544444 999887766544
No 229
>KOG2139 consensus WD40 repeat protein [General function prediction only]
Probab=99.00 E-value=2.2e-08 Score=88.56 Aligned_cols=181 Identities=12% Similarity=0.098 Sum_probs=122.2
Q ss_pred CCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeC--CceeEEEEeC---CeEEEEECCEEEEEEc
Q 020784 127 GGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFR--SEVRSVKLRR---DRIIVVLEQKIFVYNF 201 (321)
Q Consensus 127 ~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~--~~v~~v~~~~---~~~~~~~~~~I~iwd~ 201 (321)
+-.+..++|+.+-..++++. .|..|||+|-.. .+...++.. ..|++++|-+ ..++++....|+||..
T Consensus 98 ~~dlr~~aWhqH~~~fava~-------nddvVriy~kss-t~pt~Lks~sQrnvtclawRPlsaselavgCr~gIciW~~ 169 (445)
T KOG2139|consen 98 EIDLRGVAWHQHIIAFAVAT-------NDDVVRIYDKSS-TCPTKLKSVSQRNVTCLAWRPLSASELAVGCRAGICIWSD 169 (445)
T ss_pred hcceeeEeechhhhhhhhhc-------cCcEEEEeccCC-CCCceecchhhcceeEEEeccCCcceeeeeecceeEEEEc
Confidence 34567788887766666666 788999999776 444444443 4799999976 4688888889999987
Q ss_pred CC-cEEE-----------EEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEEee-ccccceeEEEECC
Q 020784 202 AD-LKLL-----------HQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKFIM-AHDSRIACFALTQ 268 (321)
Q Consensus 202 ~~-~~~~-----------~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~-~H~~~V~~vafsp 268 (321)
.. ...- +.++. .+-..+..+..+.|+..++.+.-.|..|.|||..++...-+. .--+.++-+.|||
T Consensus 170 s~tln~~r~~~~~s~~~~qvl~~-pgh~pVtsmqwn~dgt~l~tAS~gsssi~iWdpdtg~~~pL~~~glgg~slLkwSP 248 (445)
T KOG2139|consen 170 SRTLNANRNIRMMSTHHLQVLQD-PGHNPVTSMQWNEDGTILVTASFGSSSIMIWDPDTGQKIPLIPKGLGGFSLLKWSP 248 (445)
T ss_pred CcccccccccccccccchhheeC-CCCceeeEEEEcCCCCEEeecccCcceEEEEcCCCCCcccccccCCCceeeEEEcC
Confidence 32 1111 11222 122345556666677888865666778999999877655444 4556789999999
Q ss_pred CCCEEEEEeCCCcEEEEEEc-CCCcEEEEEeCCCccee-EEEeecCceEEEe
Q 020784 269 DGQLLATSSTKGTLVRIFNT-LDGTLLQEECCPSISAQ-SGLWLSSAWLRVL 318 (321)
Q Consensus 269 dg~~las~S~Dgt~IrIWd~-~tg~~i~~~~~g~~~~~-~~~s~d~~~la~~ 318 (321)
||.+|..+.-|+. .++|+. ++-.+.+.. .+..... .+.+++|++|..+
T Consensus 249 dgd~lfaAt~dav-frlw~e~q~wt~erw~-lgsgrvqtacWspcGsfLLf~ 298 (445)
T KOG2139|consen 249 DGDVLFAATCDAV-FRLWQENQSWTKERWI-LGSGRVQTACWSPCGSFLLFA 298 (445)
T ss_pred CCCEEEEecccce-eeeehhcccceeccee-ccCCceeeeeecCCCCEEEEE
Confidence 9999999999999 999954 443333333 2333333 3667888887553
No 230
>KOG2315 consensus Predicted translation initiation factor related to eIF-3a [Translation, ribosomal structure and biogenesis]
Probab=98.99 E-value=5.1e-07 Score=84.06 Aligned_cols=100 Identities=10% Similarity=0.091 Sum_probs=70.5
Q ss_pred CCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCC---CcEEEEEEcCCCc
Q 020784 216 PKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTK---GTLVRIFNTLDGT 292 (321)
Q Consensus 216 ~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~D---gt~IrIWd~~tg~ 292 (321)
++..+.+++++...-++ -|-.--.|.|+|+....+..| -.++=+++-|+|.|++++-++.+ |. |-|||+.+.+
T Consensus 272 PVhdv~W~~s~~EF~Vv-yGfMPAkvtifnlr~~~v~df--~egpRN~~~fnp~g~ii~lAGFGNL~G~-mEvwDv~n~K 347 (566)
T KOG2315|consen 272 PVHDVTWSPSGREFAVV-YGFMPAKVTIFNLRGKPVFDF--PEGPRNTAFFNPHGNIILLAGFGNLPGD-MEVWDVPNRK 347 (566)
T ss_pred CceEEEECCCCCEEEEE-EecccceEEEEcCCCCEeEeC--CCCCccceEECCCCCEEEEeecCCCCCc-eEEEeccchh
Confidence 44444444443222233 366666777777665554443 45666899999999999998875 57 9999999999
Q ss_pred EEEEEeCCCcceeEEEeecCceEEEeec
Q 020784 293 LLQEECCPSISAQSGLWLSSAWLRVLRT 320 (321)
Q Consensus 293 ~i~~~~~g~~~~~~~~s~d~~~la~~~~ 320 (321)
++.++.. .+....-.++||+|+.+|+|
T Consensus 348 ~i~~~~a-~~tt~~eW~PdGe~flTATT 374 (566)
T KOG2315|consen 348 LIAKFKA-ANTTVFEWSPDGEYFLTATT 374 (566)
T ss_pred hcccccc-CCceEEEEcCCCcEEEEEec
Confidence 9998853 44455688999999999876
No 231
>KOG1523 consensus Actin-related protein Arp2/3 complex, subunit ARPC1/p41-ARC [Cytoskeleton]
Probab=98.99 E-value=1.4e-08 Score=88.34 Aligned_cols=181 Identities=17% Similarity=0.120 Sum_probs=128.1
Q ss_pred CCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCc---EEEEEe-eCCceeEEEEeCC--eEEEEE-CCEEEEE
Q 020784 127 GGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSR---CIGELS-FRSEVRSVKLRRD--RIIVVL-EQKIFVY 199 (321)
Q Consensus 127 ~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~---~~~~~~-~~~~v~~v~~~~~--~~~~~~-~~~I~iw 199 (321)
..+|.+.++..+...+|++. +.+.|.|+.....+ ...+++ +...|+.|+|.++ ++..|. |..-++|
T Consensus 10 ~~pitchAwn~drt~iAv~~-------~~~evhiy~~~~~~~w~~~htls~Hd~~vtgvdWap~snrIvtcs~drnayVw 82 (361)
T KOG1523|consen 10 LEPITCHAWNSDRTQIAVSP-------NNHEVHIYSMLGADLWEPAHTLSEHDKIVTGVDWAPKSNRIVTCSHDRNAYVW 82 (361)
T ss_pred cCceeeeeecCCCceEEecc-------CCceEEEEEecCCCCceeceehhhhCcceeEEeecCCCCceeEccCCCCcccc
Confidence 46788999998888888887 55889999987665 334444 4568999999875 455554 5689999
Q ss_pred Ec-CCcEEEEE--EeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceE-----EeeccccceeEEEECCCCC
Q 020784 200 NF-ADLKLLHQ--IETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTK-----FIMAHDSRIACFALTQDGQ 271 (321)
Q Consensus 200 d~-~~~~~~~~--l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~-----~l~~H~~~V~~vafspdg~ 271 (321)
.. ..++=..+ +..+.... .++...|..+.+|+ |+....|.|+-++.+.-- .-+.|.+.|+++.|+|++-
T Consensus 83 ~~~~~~~WkptlvLlRiNrAA--t~V~WsP~enkFAV-gSgar~isVcy~E~ENdWWVsKhikkPirStv~sldWhpnnV 159 (361)
T KOG1523|consen 83 TQPSGGTWKPTLVLLRINRAA--TCVKWSPKENKFAV-GSGARLISVCYYEQENDWWVSKHIKKPIRSTVTSLDWHPNNV 159 (361)
T ss_pred ccCCCCeeccceeEEEeccce--eeEeecCcCceEEe-ccCccEEEEEEEecccceehhhhhCCccccceeeeeccCCcc
Confidence 98 33332222 33333333 34444445577885 888888999776554322 4456788999999999999
Q ss_pred EEEEEeCCCcEEEEEEcC------------------CCcEEEEE-eCCCcceeEEEeecCceEEEe
Q 020784 272 LLATSSTKGTLVRIFNTL------------------DGTLLQEE-CCPSISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 272 ~las~S~Dgt~IrIWd~~------------------tg~~i~~~-~~g~~~~~~~~s~d~~~la~~ 318 (321)
+||+||.|+. .|||..- =|+++.++ ..+.-...+.|+++|..||-.
T Consensus 160 LlaaGs~D~k-~rVfSayIK~Vdekpap~pWgsk~PFG~lm~E~~~~ggwvh~v~fs~sG~~lawv 224 (361)
T KOG1523|consen 160 LLAAGSTDGK-CRVFSAYIKGVDEKPAPTPWGSKMPFGQLMSEASSSGGWVHGVLFSPSGNRLAWV 224 (361)
T ss_pred eecccccCcc-eeEEEEeeeccccCCCCCCCccCCcHHHHHHhhccCCCceeeeEeCCCCCEeeEe
Confidence 9999999999 9999642 14455666 455556677889999888753
No 232
>KOG1334 consensus WD40 repeat protein [General function prediction only]
Probab=98.99 E-value=3.2e-09 Score=96.93 Aligned_cols=79 Identities=18% Similarity=0.222 Sum_probs=61.0
Q ss_pred EeccCCCCceEEEeeCC-CceEEEeecCCCCcEEEEeeCCcce-EEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEE
Q 020784 210 IETIANPKGLCAVSQGV-GSLVLVCPGLQKGQVRVEHYASKRT-KFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 210 l~~~~~~~~~~~~s~~~-d~~~la~sGs~dg~V~i~d~~~~~~-~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd 287 (321)
+++|.+...+-.+.+-+ ...+++ ||+.-|.|.||+..+..+ ..+.+-...|+||.=+|--..|||.+-|.. ||||-
T Consensus 387 YKGHrN~~TVKgVNFfGPrsEyVv-SGSDCGhIFiW~K~t~eii~~MegDr~VVNCLEpHP~~PvLAsSGid~D-VKIWT 464 (559)
T KOG1334|consen 387 YKGHRNSRTVKGVNFFGPRSEYVV-SGSDCGHIFIWDKKTGEIIRFMEGDRHVVNCLEPHPHLPVLASSGIDHD-VKIWT 464 (559)
T ss_pred hcccccccccceeeeccCccceEE-ecCccceEEEEecchhHHHHHhhcccceEeccCCCCCCchhhccCCccc-eeeec
Confidence 66776655555554433 335555 799999999999888774 456666669999999999999999999999 99997
Q ss_pred cCC
Q 020784 288 TLD 290 (321)
Q Consensus 288 ~~t 290 (321)
-.+
T Consensus 465 P~~ 467 (559)
T KOG1334|consen 465 PLT 467 (559)
T ss_pred CCc
Confidence 644
No 233
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=98.98 E-value=2.3e-06 Score=78.20 Aligned_cols=218 Identities=9% Similarity=-0.017 Sum_probs=134.2
Q ss_pred EcCCCCEEEEEcC-----------CcEEEEEecCCceeEEeeeec------CCceEEEEEecCCCeEEEEeCCCCCCCCC
Q 020784 93 FNQDHGCFAAGTD-----------HGFRIYNCDPFREIFRRDFER------GGGIGVVEMLFRCNILALVGGGPDPQYPL 155 (321)
Q Consensus 93 fs~dg~~lasg~~-----------~gv~vw~~~~~~~~~~~~~~~------~~~v~~v~~~~~~~~~~~~sg~~~~~~~d 155 (321)
++|||+.|+.+.. +.|.|||..+.+.+....... ...-....++++++.+.+..-. .+
T Consensus 53 ~spDg~~lyva~~~~~R~~~G~~~d~V~v~D~~t~~~~~~i~~p~~p~~~~~~~~~~~~ls~dgk~l~V~n~~-----p~ 127 (352)
T TIGR02658 53 VASDGSFFAHASTVYSRIARGKRTDYVEVIDPQTHLPIADIELPEGPRFLVGTYPWMTSLTPDNKTLLFYQFS-----PS 127 (352)
T ss_pred ECCCCCEEEEEeccccccccCCCCCEEEEEECccCcEEeEEccCCCchhhccCccceEEECCCCCEEEEecCC-----CC
Confidence 9999998765443 568899999998876665310 1112256778888888776532 36
Q ss_pred CcEEEEeCCCCcEEEEEeeCCceeEEEEeC-CeEEEEECCEEEEEEcC-CcEE-EEEEe---ccCCCCceE-EEeeCCCc
Q 020784 156 NKVMIWDDHQSRCIGELSFRSEVRSVKLRR-DRIIVVLEQKIFVYNFA-DLKL-LHQIE---TIANPKGLC-AVSQGVGS 228 (321)
Q Consensus 156 ~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~-~~~~~~~~~~I~iwd~~-~~~~-~~~l~---~~~~~~~~~-~~s~~~d~ 228 (321)
+.|-+.|+.+++.+.++.......-+.... ...+.|.|+......+. +++. ..+.. ....++..- .+.+. |+
T Consensus 128 ~~V~VvD~~~~kvv~ei~vp~~~~vy~t~e~~~~~~~~Dg~~~~v~~d~~g~~~~~~~~vf~~~~~~v~~rP~~~~~-dg 206 (352)
T TIGR02658 128 PAVGVVDLEGKAFVRMMDVPDCYHIFPTANDTFFMHCRDGSLAKVGYGTKGNPKIKPTEVFHPEDEYLINHPAYSNK-SG 206 (352)
T ss_pred CEEEEEECCCCcEEEEEeCCCCcEEEEecCCccEEEeecCceEEEEecCCCceEEeeeeeecCCccccccCCceEcC-CC
Confidence 899999999999999888765333333333 23444556544443332 2221 11111 100111000 23332 34
Q ss_pred eEEEeecCCCCcEEEEeeCCcceE------Eeec-------cccceeEEEECCCCCEEEEEeC---------C-CcEEEE
Q 020784 229 LVLVCPGLQKGQVRVEHYASKRTK------FIMA-------HDSRIACFALTQDGQLLATSST---------K-GTLVRI 285 (321)
Q Consensus 229 ~~la~sGs~dg~V~i~d~~~~~~~------~l~~-------H~~~V~~vafspdg~~las~S~---------D-gt~IrI 285 (321)
..+.+ +..|.|.+.|+...... .+.. ..+.+.-++++++|+++..... . +. |-+
T Consensus 207 ~~~~v--s~eG~V~~id~~~~~~~~~~~~~~~~~~~~~~~wrP~g~q~ia~~~dg~~lyV~~~~~~~~thk~~~~~-V~V 283 (352)
T TIGR02658 207 RLVWP--TYTGKIFQIDLSSGDAKFLPAIEAFTEAEKADGWRPGGWQQVAYHRARDRIYLLADQRAKWTHKTASRF-LFV 283 (352)
T ss_pred cEEEE--ecCCeEEEEecCCCcceecceeeeccccccccccCCCcceeEEEcCCCCEEEEEecCCccccccCCCCE-EEE
Confidence 44443 34499999885432211 1111 2233445999999887666431 1 35 999
Q ss_pred EEcCCCcEEEEEeCCCcceeEEEeecCc-eEEEee
Q 020784 286 FNTLDGTLLQEECCPSISAQSGLWLSSA-WLRVLR 319 (321)
Q Consensus 286 Wd~~tg~~i~~~~~g~~~~~~~~s~d~~-~la~~~ 319 (321)
+|+.+++.+.++..|.....+.+++|++ +|.++.
T Consensus 284 iD~~t~kvi~~i~vG~~~~~iavS~Dgkp~lyvtn 318 (352)
T TIGR02658 284 VDAKTGKRLRKIELGHEIDSINVSQDAKPLLYALS 318 (352)
T ss_pred EECCCCeEEEEEeCCCceeeEEECCCCCeEEEEeC
Confidence 9999999999999999988999999999 666543
No 234
>PRK00178 tolB translocation protein TolB; Provisional
Probab=98.97 E-value=3.9e-07 Score=86.49 Aligned_cols=185 Identities=13% Similarity=0.056 Sum_probs=116.5
Q ss_pred CCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCC--eEEEEE--CC--EEEEEE
Q 020784 127 GGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRD--RIIVVL--EQ--KIFVYN 200 (321)
Q Consensus 127 ~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~--~~~~~~--~~--~I~iwd 200 (321)
...+....|+++++.++.++... ....|.+||+.+++..........+....|+++ .++... ++ .|.+||
T Consensus 198 ~~~~~~p~wSpDG~~la~~s~~~----~~~~l~~~~l~~g~~~~l~~~~g~~~~~~~SpDG~~la~~~~~~g~~~Iy~~d 273 (430)
T PRK00178 198 REPILSPRWSPDGKRIAYVSFEQ----KRPRIFVQNLDTGRREQITNFEGLNGAPAWSPDGSKLAFVLSKDGNPEIYVMD 273 (430)
T ss_pred CCceeeeeECCCCCEEEEEEcCC----CCCEEEEEECCCCCEEEccCCCCCcCCeEECCCCCEEEEEEccCCCceEEEEE
Confidence 45667778999999998876331 124699999998876544344445556888876 344433 22 789999
Q ss_pred cCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCc--EEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeC
Q 020784 201 FADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQ--VRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSST 278 (321)
Q Consensus 201 ~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~--V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~ 278 (321)
+.+++.. .+..+........+++ |+..++++...+|. |.+++..++....+..........+|+|||++|+..+.
T Consensus 274 ~~~~~~~-~lt~~~~~~~~~~~sp--Dg~~i~f~s~~~g~~~iy~~d~~~g~~~~lt~~~~~~~~~~~Spdg~~i~~~~~ 350 (430)
T PRK00178 274 LASRQLS-RVTNHPAIDTEPFWGK--DGRTLYFTSDRGGKPQIYKVNVNGGRAERVTFVGNYNARPRLSADGKTLVMVHR 350 (430)
T ss_pred CCCCCeE-EcccCCCCcCCeEECC--CCCEEEEEECCCCCceEEEEECCCCCEEEeecCCCCccceEECCCCCEEEEEEc
Confidence 9877653 3443333233345554 55656554555554 55567666555444322334456789999999988765
Q ss_pred CC--cEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEee
Q 020784 279 KG--TLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 279 Dg--t~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~~ 319 (321)
++ ..|.+||+.+++. +.+..........+++||++|+.++
T Consensus 351 ~~~~~~l~~~dl~tg~~-~~lt~~~~~~~p~~spdg~~i~~~~ 392 (430)
T PRK00178 351 QDGNFHVAAQDLQRGSV-RILTDTSLDESPSVAPNGTMLIYAT 392 (430)
T ss_pred cCCceEEEEEECCCCCE-EEccCCCCCCCceECCCCCEEEEEE
Confidence 33 2378899999875 3343332223348899999998764
No 235
>KOG1354 consensus Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=98.96 E-value=2.1e-08 Score=88.11 Aligned_cols=202 Identities=14% Similarity=0.237 Sum_probs=119.8
Q ss_pred CCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCce-e--EEeeee-c------------CCceEEEEEecCCC--eEEEE
Q 020784 85 PPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFRE-I--FRRDFE-R------------GGGIGVVEMLFRCN--ILALV 145 (321)
Q Consensus 85 ~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~-~--~~~~~~-~------------~~~v~~v~~~~~~~--~~~~~ 145 (321)
..-|.+|.|.-+|.+||+|..+| |.+|.-+.... + +.-.++ | ...|..+.|...++ .+.+.
T Consensus 25 adiis~vef~~~Ge~LatGdkgGRVv~f~r~~~~~~ey~~~t~fqshepEFDYLkSleieEKinkIrw~~~~n~a~FLls 104 (433)
T KOG1354|consen 25 ADIISAVEFDHYGERLATGDKGGRVVLFEREKLYKGEYNFQTEFQSHEPEFDYLKSLEIEEKINKIRWLDDGNLAEFLLS 104 (433)
T ss_pred hcceeeEEeecccceEeecCCCCeEEEeecccccccceeeeeeeeccCcccchhhhhhhhhhhhhceecCCCCccEEEEe
Confidence 35789999999999999999877 66775432211 1 111111 1 22455667766554 34444
Q ss_pred eCCCCCCCCCCcEEEEeCCCCcEEE---------------EEe----------------------eCCceeEEEEeCCeE
Q 020784 146 GGGPDPQYPLNKVMIWDDHQSRCIG---------------ELS----------------------FRSEVRSVKLRRDRI 188 (321)
Q Consensus 146 sg~~~~~~~d~~v~iWD~~~~~~~~---------------~~~----------------------~~~~v~~v~~~~~~~ 188 (321)
+ +|++||+|.+....... .++ +.-.|.++.++.+.-
T Consensus 105 t-------NdktiKlWKi~er~~k~~~~~~~~~~~~~~~~~lr~p~~~~~~~~vea~prRv~aNaHtyhiNSIS~NsD~E 177 (433)
T KOG1354|consen 105 T-------NDKTIKLWKIRERGSKKEGYNLPEEGPPGTITSLRLPVEGRHDLEVEASPRRVYANAHTYHINSISVNSDKE 177 (433)
T ss_pred c-------CCcceeeeeeeccccccccccccccCCCCccceeeceeeccccceeeeeeeeeccccceeEeeeeeecCccc
Confidence 4 78999999875432111 000 112455666666543
Q ss_pred -EEEECC-EEEEEEcCC-cEEEEEEec--cC-----CCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcce-----E-
Q 020784 189 -IVVLEQ-KIFVYNFAD-LKLLHQIET--IA-----NPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRT-----K- 252 (321)
Q Consensus 189 -~~~~~~-~I~iwd~~~-~~~~~~l~~--~~-----~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~-----~- 252 (321)
++..|+ .|.+|++.- .+....++- +. ..+...-|+|.. ++++++ .+..|+|++-|++...+ +
T Consensus 178 t~lSADdLRINLWnlei~d~sFnIVDIKP~nmEeLteVITsaEFhp~~-cn~f~Y-SSSKGtIrLcDmR~~aLCd~hsKl 255 (433)
T KOG1354|consen 178 TFLSADDLRINLWNLEIIDQSFNIVDIKPANMEELTEVITSAEFHPHH-CNVFVY-SSSKGTIRLCDMRQSALCDAHSKL 255 (433)
T ss_pred eEeeccceeeeeccccccCCceeEEEccccCHHHHHHHHhhhccCHhH-ccEEEE-ecCCCcEEEeechhhhhhcchhhh
Confidence 333344 899999853 222222221 11 012344566653 456776 67789999988763211 1
Q ss_pred -----------EeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEc-CCCcEEEEE
Q 020784 253 -----------FIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNT-LDGTLLQEE 297 (321)
Q Consensus 253 -----------~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~-~tg~~i~~~ 297 (321)
-|..-.+.|..+.|+++|+|++|-.. -+ |+|||+ ...+.+.++
T Consensus 256 fEepedp~~rsffseiIsSISDvKFs~sGryilsRDy-lt-vk~wD~nme~~pv~t~ 310 (433)
T KOG1354|consen 256 FEEPEDPSSRSFFSEIISSISDVKFSHSGRYILSRDY-LT-VKLWDLNMEAKPVETY 310 (433)
T ss_pred hccccCCcchhhHHHHhhhhhceEEccCCcEEEEecc-ce-eEEEeccccCCcceEE
Confidence 13334567899999999999997753 45 999999 455555554
No 236
>PRK04792 tolB translocation protein TolB; Provisional
Probab=98.95 E-value=4.1e-07 Score=86.77 Aligned_cols=185 Identities=12% Similarity=0.049 Sum_probs=113.1
Q ss_pred CCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCe--EEEEE--CC--EEEEEE
Q 020784 127 GGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDR--IIVVL--EQ--KIFVYN 200 (321)
Q Consensus 127 ~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~--~~~~~--~~--~I~iwd 200 (321)
...+....|+++++.++.++... ....|.+||+.+++......+........|+++. ++.+. ++ .|.+||
T Consensus 217 ~~~~~~p~wSPDG~~La~~s~~~----g~~~L~~~dl~tg~~~~lt~~~g~~~~~~wSPDG~~La~~~~~~g~~~Iy~~d 292 (448)
T PRK04792 217 PEPLMSPAWSPDGRKLAYVSFEN----RKAEIFVQDIYTQVREKVTSFPGINGAPRFSPDGKKLALVLSKDGQPEIYVVD 292 (448)
T ss_pred CCcccCceECCCCCEEEEEEecC----CCcEEEEEECCCCCeEEecCCCCCcCCeeECCCCCEEEEEEeCCCCeEEEEEE
Confidence 45666778999999998876321 1246899999888754333344444567888763 44432 23 688889
Q ss_pred cCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEE--EeeCCcceEEeeccccceeEEEECCCCCEEEEEeC
Q 020784 201 FADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRV--EHYASKRTKFIMAHDSRIACFALTQDGQLLATSST 278 (321)
Q Consensus 201 ~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i--~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~ 278 (321)
+.+++. +.+..+.......++++ |+..++++...+|...| ++..++....+..+.......+|+|||++|+..+.
T Consensus 293 l~tg~~-~~lt~~~~~~~~p~wSp--DG~~I~f~s~~~g~~~Iy~~dl~~g~~~~Lt~~g~~~~~~~~SpDG~~l~~~~~ 369 (448)
T PRK04792 293 IATKAL-TRITRHRAIDTEPSWHP--DGKSLIFTSERGGKPQIYRVNLASGKVSRLTFEGEQNLGGSITPDGRSMIMVNR 369 (448)
T ss_pred CCCCCe-EECccCCCCccceEECC--CCCEEEEEECCCCCceEEEEECCCCCEEEEecCCCCCcCeeECCCCCEEEEEEe
Confidence 887764 33443333333445555 55666665555555444 66665555444333333456799999999887765
Q ss_pred CC-c-EEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEee
Q 020784 279 KG-T-LVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 279 Dg-t-~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~~ 319 (321)
++ . .|.++|+.+++.. .+..+.....-.+++||++|+.++
T Consensus 370 ~~g~~~I~~~dl~~g~~~-~lt~~~~d~~ps~spdG~~I~~~~ 411 (448)
T PRK04792 370 TNGKFNIARQDLETGAMQ-VLTSTRLDESPSVAPNGTMVIYST 411 (448)
T ss_pred cCCceEEEEEECCCCCeE-EccCCCCCCCceECCCCCEEEEEE
Confidence 43 2 1445688888753 333322222337899999988754
No 237
>KOG1524 consensus WD40 repeat-containing protein CHE-2 [General function prediction only]
Probab=98.95 E-value=7.7e-09 Score=95.50 Aligned_cols=216 Identities=10% Similarity=0.107 Sum_probs=126.9
Q ss_pred CCCCeEEEEEcCCCCEEEEEcCCcEEEEE-ecCCceeEEeeeecCCceEEEE-E-------ecCCCeEEEEeCCCCCCCC
Q 020784 84 PPPTLLHISFNQDHGCFAAGTDHGFRIYN-CDPFREIFRRDFERGGGIGVVE-M-------LFRCNILALVGGGPDPQYP 154 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~~gv~vw~-~~~~~~~~~~~~~~~~~v~~v~-~-------~~~~~~~~~~sg~~~~~~~ 154 (321)
|...|.||.|+.+...+.+++|+.+.+|+ +.+.... .... -+.-+.... . -...+.+++++ +
T Consensus 13 ~~e~vc~v~w~~~eei~~~~dDh~~~~~~~~~~~s~~-~~~~-p~df~pt~~h~~~rs~~~g~~~d~~~i~s-------~ 83 (737)
T KOG1524|consen 13 NSEKVCCVDWSSNEEIYFVSDDHQIFKWSDVSRDSVE-VAKL-PDDFVPTDMHLGGRSSGGGKGSDTLLICS-------N 83 (737)
T ss_pred cceeEEeecccccceEEEeccCceEEEeecccchhhh-hhhC-CcccCCccccccccccCCCCCcceEEEEc-------C
Confidence 44567899999988888888887776664 3222111 0000 000000000 0 01123455555 6
Q ss_pred CCcEEEEeCCCCcEEEEEe-eCCceeEEEEeCCeE--E-EEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceE
Q 020784 155 LNKVMIWDDHQSRCIGELS-FRSEVRSVKLRRDRI--I-VVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLV 230 (321)
Q Consensus 155 d~~v~iWD~~~~~~~~~~~-~~~~v~~v~~~~~~~--~-~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~ 230 (321)
||.+.|-+-. ++.-..+. +.+.+.+-.|++++. + ++.|+.|++|.-..+ +..++.....++.+.++.++. .-
T Consensus 84 DGkf~il~k~-~rVE~sv~AH~~A~~~gRW~~dGtgLlt~GEDG~iKiWSrsGM-LRStl~Q~~~~v~c~~W~p~S--~~ 159 (737)
T KOG1524|consen 84 DGRFVILNKS-ARVERSISAHAAAISSGRWSPDGAGLLTAGEDGVIKIWSRSGM-LRSTVVQNEESIRCARWAPNS--NS 159 (737)
T ss_pred CceEEEeccc-chhhhhhhhhhhhhhhcccCCCCceeeeecCCceEEEEeccch-HHHHHhhcCceeEEEEECCCC--Cc
Confidence 7888777632 22222232 345677888998753 3 334679999985432 222333333445555655554 33
Q ss_pred EEeecCCCCcEEEEeeCCc-ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeE--E
Q 020784 231 LVCPGLQKGQVRVEHYASK-RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQS--G 307 (321)
Q Consensus 231 la~sGs~dg~V~i~d~~~~-~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~--~ 307 (321)
+++ ...|.+.|-.+... .+...++|++-|.++.|++...+++||++|-. .||||..-.-++.. ..++-.+. +
T Consensus 160 vl~--c~g~h~~IKpL~~n~k~i~WkAHDGiiL~~~W~~~s~lI~sgGED~k-fKvWD~~G~~Lf~S--~~~ey~ITSva 234 (737)
T KOG1524|consen 160 IVF--CQGGHISIKPLAANSKIIRWRAHDGLVLSLSWSTQSNIIASGGEDFR-FKIWDAQGANLFTS--AAEEYAITSVA 234 (737)
T ss_pred eEE--ecCCeEEEeecccccceeEEeccCcEEEEeecCccccceeecCCcee-EEeecccCcccccC--Chhccceeeee
Confidence 443 34467888655543 35688999999999999999999999999999 99999765444432 23444444 4
Q ss_pred EeecCceEEEe
Q 020784 308 LWLSSAWLRVL 318 (321)
Q Consensus 308 ~s~d~~~la~~ 318 (321)
+.+| +..|+.
T Consensus 235 ~npd-~~~~v~ 244 (737)
T KOG1524|consen 235 FNPE-KDYLLW 244 (737)
T ss_pred eccc-cceeee
Confidence 4455 444443
No 238
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=98.94 E-value=4.5e-06 Score=76.97 Aligned_cols=204 Identities=14% Similarity=0.177 Sum_probs=129.5
Q ss_pred CeEEEEEcCCCCEEEEEcC--CcEEEEEecCCceeEEe--eee-----------cCCceEEEEEecCCCeEEEEeCCCCC
Q 020784 87 TLLHISFNQDHGCFAAGTD--HGFRIYNCDPFREIFRR--DFE-----------RGGGIGVVEMLFRCNILALVGGGPDP 151 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~--~gv~vw~~~~~~~~~~~--~~~-----------~~~~v~~v~~~~~~~~~~~~sg~~~~ 151 (321)
.-..+++++||++|+++.- +.+.+++++..+.+... ... ...+.-.+.+.++++.++++.-+.
T Consensus 88 ~p~~i~~~~~g~~l~vany~~g~v~v~~l~~~g~l~~~~~~~~~~g~g~~~~rq~~~h~H~v~~~pdg~~v~v~dlG~-- 165 (345)
T PF10282_consen 88 SPCHIAVDPDGRFLYVANYGGGSVSVFPLDDDGSLGEVVQTVRHEGSGPNPDRQEGPHPHQVVFSPDGRFVYVPDLGA-- 165 (345)
T ss_dssp CEEEEEECTTSSEEEEEETTTTEEEEEEECTTSEEEEEEEEEESEEEESSTTTTSSTCEEEEEE-TTSSEEEEEETTT--
T ss_pred CcEEEEEecCCCEEEEEEccCCeEEEEEccCCcccceeeeecccCCCCCcccccccccceeEEECCCCCEEEEEecCC--
Confidence 4567999999999998864 44779999774332222 110 123345677889999888776542
Q ss_pred CCCCCcEEEEeCCCCc--EEE--EEee--CCceeEEEEeCC--eEEEEE--CCEEEEEEcC--Cc--EEEEEEeccC---
Q 020784 152 QYPLNKVMIWDDHQSR--CIG--ELSF--RSEVRSVKLRRD--RIIVVL--EQKIFVYNFA--DL--KLLHQIETIA--- 214 (321)
Q Consensus 152 ~~~d~~v~iWD~~~~~--~~~--~~~~--~~~v~~v~~~~~--~~~~~~--~~~I~iwd~~--~~--~~~~~l~~~~--- 214 (321)
..|.+|+++... ... .+.. ...+..+.|+++ .+++.. ++.|.+|++. ++ +.++.+....
T Consensus 166 ----D~v~~~~~~~~~~~l~~~~~~~~~~G~GPRh~~f~pdg~~~Yv~~e~s~~v~v~~~~~~~g~~~~~~~~~~~~~~~ 241 (345)
T PF10282_consen 166 ----DRVYVYDIDDDTGKLTPVDSIKVPPGSGPRHLAFSPDGKYAYVVNELSNTVSVFDYDPSDGSLTEIQTISTLPEGF 241 (345)
T ss_dssp ----TEEEEEEE-TTS-TEEEEEEEECSTTSSEEEEEE-TTSSEEEEEETTTTEEEEEEEETTTTEEEEEEEEESCETTS
T ss_pred ----CEEEEEEEeCCCceEEEeeccccccCCCCcEEEEcCCcCEEEEecCCCCcEEEEeecccCCceeEEEEeeeccccc
Confidence 579999987654 322 2332 346888999986 566665 4699999987 43 3444444321
Q ss_pred C-CCceEEEeeCCCceEEEeecCCCCcEEEEeeC--CcceEE---eeccccceeEEEECCCCCEEEEEeCCCcEEEEEEc
Q 020784 215 N-PKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYA--SKRTKF---IMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 215 ~-~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~--~~~~~~---l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~ 288 (321)
. ......+..++|+.+|.++....+.|.++++. ++.+.. +.......+.++|+|+|++|+.+..+...|.+|++
T Consensus 242 ~~~~~~~~i~ispdg~~lyvsnr~~~sI~vf~~d~~~g~l~~~~~~~~~G~~Pr~~~~s~~g~~l~Va~~~s~~v~vf~~ 321 (345)
T PF10282_consen 242 TGENAPAEIAISPDGRFLYVSNRGSNSISVFDLDPATGTLTLVQTVPTGGKFPRHFAFSPDGRYLYVANQDSNTVSVFDI 321 (345)
T ss_dssp CSSSSEEEEEE-TTSSEEEEEECTTTEEEEEEECTTTTTEEEEEEEEESSSSEEEEEE-TTSSEEEEEETTTTEEEEEEE
T ss_pred cccCCceeEEEecCCCEEEEEeccCCEEEEEEEecCCCceEEEEEEeCCCCCccEEEEeCCCCEEEEEecCCCeEEEEEE
Confidence 1 11344555556667776667777889998873 344432 33234458999999999999988765544999976
Q ss_pred --CCCcEEEE
Q 020784 289 --LDGTLLQE 296 (321)
Q Consensus 289 --~tg~~i~~ 296 (321)
++|++...
T Consensus 322 d~~tG~l~~~ 331 (345)
T PF10282_consen 322 DPDTGKLTPV 331 (345)
T ss_dssp ETTTTEEEEE
T ss_pred eCCCCcEEEe
Confidence 57876544
No 239
>KOG1587 consensus Cytoplasmic dynein intermediate chain [Cytoskeleton]
Probab=98.93 E-value=4.1e-08 Score=94.33 Aligned_cols=203 Identities=11% Similarity=0.049 Sum_probs=128.8
Q ss_pred CcccCCCCCCeEEEEEcCCCCE--EEEEcC-CcEEEEEecCCceeE-------Ee----eeecCCceEEEEEec-CCCeE
Q 020784 78 ESTSSSPPPTLLHISFNQDHGC--FAAGTD-HGFRIYNCDPFREIF-------RR----DFERGGGIGVVEMLF-RCNIL 142 (321)
Q Consensus 78 ~~~~~~~~~~V~~v~fs~dg~~--lasg~~-~gv~vw~~~~~~~~~-------~~----~~~~~~~v~~v~~~~-~~~~~ 142 (321)
......|..+|+.+.|..+-.- |++++. ++|..|+++-..... .. +......+..+++.. +.+.+
T Consensus 284 s~~~~sh~~~v~~vvW~~~~~~~~f~s~ssDG~i~~W~~~~l~~P~e~~~~~~~~~~~~~~~~~~~~t~~~F~~~~p~~F 363 (555)
T KOG1587|consen 284 SALEVSHSEPVTAVVWLQNEHNTEFFSLSSDGSICSWDTDMLSLPVEGLLLESKKHKGQQSSKAVGATSLKFEPTDPNHF 363 (555)
T ss_pred ccccccCCcCeEEEEEeccCCCCceEEEecCCcEeeeeccccccchhhcccccccccccccccccceeeEeeccCCCceE
Confidence 3445778899999999875432 555554 558899875432200 00 000123445556544 44555
Q ss_pred EEEeCCCCCCCCCCcEEEEe---CCCCc-----EE-EEEeeCCceeEEEEeC---CeEEEEECCEEEEEEcC-CcEEEEE
Q 020784 143 ALVGGGPDPQYPLNKVMIWD---DHQSR-----CI-GELSFRSEVRSVKLRR---DRIIVVLEQKIFVYNFA-DLKLLHQ 209 (321)
Q Consensus 143 ~~~sg~~~~~~~d~~v~iWD---~~~~~-----~~-~~~~~~~~v~~v~~~~---~~~~~~~~~~I~iwd~~-~~~~~~~ 209 (321)
++++ ..|.|..=+ ..... .+ .-..+.+.|+++.+++ +.+.+++|-+++||... ....+..
T Consensus 364 iVGT-------e~G~v~~~~r~g~~~~~~~~~~~~~~~~~h~g~v~~v~~nPF~~k~fls~gDW~vriWs~~~~~~Pl~~ 436 (555)
T KOG1587|consen 364 IVGT-------EEGKVYKGCRKGYTPAPEVSYKGHSTFITHIGPVYAVSRNPFYPKNFLSVGDWTVRIWSEDVIASPLLS 436 (555)
T ss_pred EEEc-------CCcEEEEEeccCCcccccccccccccccccCcceEeeecCCCccceeeeeccceeEeccccCCCCcchh
Confidence 5555 456666532 22221 11 1122456788888765 45666677899999986 5555555
Q ss_pred EeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCc---ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEE
Q 020784 210 IETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASK---RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIF 286 (321)
Q Consensus 210 l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~---~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIW 286 (321)
+..+...+...++|+.-- .+++ +++.||.+.|||+... +....+.+....+.+.|+++|+.||.|...|+ |+|+
T Consensus 437 ~~~~~~~v~~vaWSptrp-avF~-~~d~~G~l~iWDLl~~~~~Pv~s~~~~~~~l~~~~~s~~g~~lavGd~~G~-~~~~ 513 (555)
T KOG1587|consen 437 LDSSPDYVTDVAWSPTRP-AVFA-TVDGDGNLDIWDLLQDDEEPVLSQKVCSPALTRVRWSPNGKLLAVGDANGT-THIL 513 (555)
T ss_pred hhhccceeeeeEEcCcCc-eEEE-EEcCCCceehhhhhccccCCcccccccccccceeecCCCCcEEEEecCCCc-EEEE
Confidence 555544444455555432 3344 5899999999998753 44566666777888889999999999999999 9999
Q ss_pred EcCC
Q 020784 287 NTLD 290 (321)
Q Consensus 287 d~~t 290 (321)
++..
T Consensus 514 ~l~~ 517 (555)
T KOG1587|consen 514 KLSE 517 (555)
T ss_pred EcCc
Confidence 9974
No 240
>PF00400 WD40: WD domain, G-beta repeat; InterPro: IPR019781 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events.; PDB: 2ZKQ_a 3CFV_B 3CFS_B 1PEV_A 1NR0_A 1VYH_T 3RFH_A 3O2Z_T 3FRX_C 3U5G_g ....
Probab=98.93 E-value=3.1e-09 Score=65.01 Aligned_cols=37 Identities=32% Similarity=0.601 Sum_probs=35.1
Q ss_pred ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEE
Q 020784 250 RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 250 ~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd 287 (321)
.+.++.+|.+.|++|+|+|++.+|||||.|++ |+|||
T Consensus 3 ~~~~~~~h~~~i~~i~~~~~~~~~~s~~~D~~-i~vwd 39 (39)
T PF00400_consen 3 CVRTFRGHSSSINSIAWSPDGNFLASGSSDGT-IRVWD 39 (39)
T ss_dssp EEEEEESSSSSEEEEEEETTSSEEEEEETTSE-EEEEE
T ss_pred EEEEEcCCCCcEEEEEEecccccceeeCCCCE-EEEEC
Confidence 46789999999999999999999999999999 99997
No 241
>KOG4547 consensus WD40 repeat-containing protein [General function prediction only]
Probab=98.90 E-value=3.6e-07 Score=85.49 Aligned_cols=183 Identities=15% Similarity=0.152 Sum_probs=122.8
Q ss_pred CCCCEEEEEcCCc-EEEEEecCCceeEEe--eeecCCceEEEEEe--------------------cCCCeEEEEeCCCCC
Q 020784 95 QDHGCFAAGTDHG-FRIYNCDPFREIFRR--DFERGGGIGVVEML--------------------FRCNILALVGGGPDP 151 (321)
Q Consensus 95 ~dg~~lasg~~~g-v~vw~~~~~~~~~~~--~~~~~~~v~~v~~~--------------------~~~~~~~~~sg~~~~ 151 (321)
+-+.+||....+| +|||+....+..... ..+-.+...+..|. .+...+++..
T Consensus 3 ~~~~~~A~~~~~g~l~iw~t~~~~~~~e~~p~~~~s~t~~~~~w~L~~~~s~~k~~~~~~~~~~s~~t~~lvlgt----- 77 (541)
T KOG4547|consen 3 PALDYFALSTGDGRLRIWDTAKNQLQQEFAPIASLSGTCTYTKWGLSADYSPMKWLSLEKAKKASLDTSMLVLGT----- 77 (541)
T ss_pred chhheEeecCCCCeEEEEEccCceeeeeeccchhccCcceeEEEEEEeccchHHHHhHHHHhhccCCceEEEeec-----
Confidence 4567888887777 789998776542221 11012222222221 0112223333
Q ss_pred CCCCCcEEEEeCCCCcEEEEEee---CCceeEEEEeCC--eEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeC
Q 020784 152 QYPLNKVMIWDDHQSRCIGELSF---RSEVRSVKLRRD--RIIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQG 225 (321)
Q Consensus 152 ~~~d~~v~iWD~~~~~~~~~~~~---~~~v~~v~~~~~--~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~ 225 (321)
..|.|.++++..|+....+.. .+.|.++.++.+ .+..+. +..+..|+....+.++.++....-+...+++++
T Consensus 78 --~~g~v~~ys~~~g~it~~~st~~h~~~v~~~~~~~~~~ciyS~~ad~~v~~~~~~~~~~~~~~~~~~~~~~sl~is~D 155 (541)
T KOG4547|consen 78 --PQGSVLLYSVAGGEITAKLSTDKHYGNVNEILDAQRLGCIYSVGADLKVVYILEKEKVIIRIWKEQKPLVSSLCISPD 155 (541)
T ss_pred --CCccEEEEEecCCeEEEEEecCCCCCcceeeecccccCceEecCCceeEEEEecccceeeeeeccCCCccceEEEcCC
Confidence 348899999999998887763 346777777665 345554 459999999999999988876555555666654
Q ss_pred CCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCC-----CCEEEEE-eCCCcEEEEEEcCC
Q 020784 226 VGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQD-----GQLLATS-STKGTLVRIFNTLD 290 (321)
Q Consensus 226 ~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspd-----g~~las~-S~Dgt~IrIWd~~t 290 (321)
+.++++ + .+.|++||.+++. +.+|.+|.++|+++.|--+ |.+|.+. ..+.. |-+|-+..
T Consensus 156 --~~~l~~-a--s~~ik~~~~~~kevv~~ftgh~s~v~t~~f~~~~~g~~G~~vLssa~~~r~-i~~w~v~~ 221 (541)
T KOG4547|consen 156 --GKILLT-A--SRQIKVLDIETKEVVITFTGHGSPVRTLSFTTLIDGIIGKYVLSSAAAERG-ITVWVVEK 221 (541)
T ss_pred --CCEEEe-c--cceEEEEEccCceEEEEecCCCcceEEEEEEEeccccccceeeeccccccc-eeEEEEEc
Confidence 577763 3 3689999999887 5689999999999999876 6666654 44555 78887664
No 242
>KOG2321 consensus WD40 repeat protein [General function prediction only]
Probab=98.89 E-value=5.2e-08 Score=90.79 Aligned_cols=179 Identities=15% Similarity=0.145 Sum_probs=119.8
Q ss_pred CCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCC
Q 020784 97 HGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRS 176 (321)
Q Consensus 97 g~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~ 176 (321)
-.++.+|+..-|.=+|++.++.+..... ..+.+.+|.+...-.++++.+ .+|.|-.||.++...+..+....
T Consensus 146 cDly~~gsg~evYRlNLEqGrfL~P~~~-~~~~lN~v~in~~hgLla~Gt-------~~g~VEfwDpR~ksrv~~l~~~~ 217 (703)
T KOG2321|consen 146 CDLYLVGSGSEVYRLNLEQGRFLNPFET-DSGELNVVSINEEHGLLACGT-------EDGVVEFWDPRDKSRVGTLDAAS 217 (703)
T ss_pred ccEEEeecCcceEEEEcccccccccccc-ccccceeeeecCccceEEecc-------cCceEEEecchhhhhheeeeccc
Confidence 3455555555555567777765544443 246788887766555554444 56899999988877666665544
Q ss_pred ceeEEEEeCCeEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEEeec
Q 020784 177 EVRSVKLRRDRIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKFIMA 256 (321)
Q Consensus 177 ~v~~v~~~~~~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~ 256 (321)
.|.+ ..+......+.++.+..++..+++ |+..|.|.|+|+........+.
T Consensus 218 ~v~s-----------------------------~pg~~~~~svTal~F~d~gL~~aV-Gts~G~v~iyDLRa~~pl~~kd 267 (703)
T KOG2321|consen 218 SVNS-----------------------------HPGGDAAPSVTALKFRDDGLHVAV-GTSTGSVLIYDLRASKPLLVKD 267 (703)
T ss_pred ccCC-----------------------------CccccccCcceEEEecCCceeEEe-eccCCcEEEEEcccCCceeecc
Confidence 3321 011112234566677767788886 9999999999999877666677
Q ss_pred ccc--ceeEEEECCCC--CEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceE
Q 020784 257 HDS--RIACFALTQDG--QLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWL 315 (321)
Q Consensus 257 H~~--~V~~vafspdg--~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~l 315 (321)
|.. +|..+.|.+.+ ..++| .|..++||||-.+|+......-..+...+++.+++-.+
T Consensus 268 h~~e~pi~~l~~~~~~~q~~v~S--~Dk~~~kiWd~~~Gk~~asiEpt~~lND~C~~p~sGm~ 328 (703)
T KOG2321|consen 268 HGYELPIKKLDWQDTDQQNKVVS--MDKRILKIWDECTGKPMASIEPTSDLNDFCFVPGSGMF 328 (703)
T ss_pred cCCccceeeecccccCCCceEEe--cchHHhhhcccccCCceeeccccCCcCceeeecCCceE
Confidence 754 68889997763 45554 46767999999999998877655555556777766443
No 243
>PRK01029 tolB translocation protein TolB; Provisional
Probab=98.85 E-value=3.4e-06 Score=79.96 Aligned_cols=206 Identities=11% Similarity=0.023 Sum_probs=119.5
Q ss_pred CCeEEEEEcCCCCEEE---EEcCCc---EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 86 PTLLHISFNQDHGCFA---AGTDHG---FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 86 ~~V~~v~fs~dg~~la---sg~~~g---v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
..+.+=+|+|||+.++ +...++ |.+.+++.++......+ .+......|+++++.+++++.... ..+--+.
T Consensus 185 ~~~~sP~wSPDG~~~~~~y~S~~~g~~~I~~~~l~~g~~~~lt~~--~g~~~~p~wSPDG~~Laf~s~~~g--~~di~~~ 260 (428)
T PRK01029 185 SLSITPTWMHIGSGFPYLYVSYKLGVPKIFLGSLENPAGKKILAL--QGNQLMPTFSPRKKLLAFISDRYG--NPDLFIQ 260 (428)
T ss_pred CCcccceEccCCCceEEEEEEccCCCceEEEEECCCCCceEeecC--CCCccceEECCCCCEEEEEECCCC--CcceeEE
Confidence 3566779999997532 333332 55667776654333332 344455689999999988773211 0123355
Q ss_pred EEeCCCC---cEEEEEeeC-CceeEEEEeCCe--EEEEEC--C--EEEEEEcCC-cEEEEEEeccCCCCceEEEeeCCCc
Q 020784 160 IWDDHQS---RCIGELSFR-SEVRSVKLRRDR--IIVVLE--Q--KIFVYNFAD-LKLLHQIETIANPKGLCAVSQGVGS 228 (321)
Q Consensus 160 iWD~~~~---~~~~~~~~~-~~v~~v~~~~~~--~~~~~~--~--~I~iwd~~~-~~~~~~l~~~~~~~~~~~~s~~~d~ 228 (321)
+||+..+ ......... .......|+++. ++...+ + .|.++++.. +...+.+...........+++ |+
T Consensus 261 ~~~~~~g~~g~~~~lt~~~~~~~~~p~wSPDG~~Laf~s~~~g~~~ly~~~~~~~g~~~~~lt~~~~~~~~p~wSP--DG 338 (428)
T PRK01029 261 SFSLETGAIGKPRRLLNEAFGTQGNPSFSPDGTRLVFVSNKDGRPRIYIMQIDPEGQSPRLLTKKYRNSSCPAWSP--DG 338 (428)
T ss_pred EeecccCCCCcceEeecCCCCCcCCeEECCCCCEEEEEECCCCCceEEEEECcccccceEEeccCCCCccceeECC--CC
Confidence 5777653 222222222 234567888774 454443 4 455555532 223344443333333445555 55
Q ss_pred eEEEeecCCCC--cEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCC--CcEEEEEEcCCCcEEEEE
Q 020784 229 LVLVCPGLQKG--QVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTK--GTLVRIFNTLDGTLLQEE 297 (321)
Q Consensus 229 ~~la~sGs~dg--~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~D--gt~IrIWd~~tg~~i~~~ 297 (321)
..|++.+..+| .|.+||..++....+......+....|+|||++|+-.+.+ ...|.+||+.+++...-.
T Consensus 339 ~~Laf~~~~~g~~~I~v~dl~~g~~~~Lt~~~~~~~~p~wSpDG~~L~f~~~~~g~~~L~~vdl~~g~~~~Lt 411 (428)
T PRK01029 339 KKIAFCSVIKGVRQICVYDLATGRDYQLTTSPENKESPSWAIDSLHLVYSAGNSNESELYLISLITKKTRKIV 411 (428)
T ss_pred CEEEEEEcCCCCcEEEEEECCCCCeEEccCCCCCccceEECCCCCEEEEEECCCCCceEEEEECCCCCEEEee
Confidence 76766554444 5777998887777666555567889999999987754332 223888899888764433
No 244
>KOG0974 consensus WD-repeat protein WDR6, WD repeat superfamily [General function prediction only]
Probab=98.83 E-value=1.1e-07 Score=94.08 Aligned_cols=134 Identities=12% Similarity=0.146 Sum_probs=96.6
Q ss_pred EeCCeEEEEE-CCEEEEEEcCCcEEEEEEeccCCCC-ceEE-EeeCCCceEEEeecCCCCcEEEEeeCCcce-EEeeccc
Q 020784 183 LRRDRIIVVL-EQKIFVYNFADLKLLHQIETIANPK-GLCA-VSQGVGSLVLVCPGLQKGQVRVEHYASKRT-KFIMAHD 258 (321)
Q Consensus 183 ~~~~~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~-~~~~-~s~~~d~~~la~sGs~dg~V~i~d~~~~~~-~~l~~H~ 258 (321)
+...++++.+ .+.+-+||......+.++.....-. ..+. +-..++..+++ +|+.-|.|.+|+...... ..+.+|.
T Consensus 97 ~e~k~i~l~~~~ns~~i~d~~~~~~~~~i~~~er~~l~~~~~~g~s~~~~~i~-~gsv~~~iivW~~~~dn~p~~l~GHe 175 (967)
T KOG0974|consen 97 EENKKIALVTSRNSLLIRDSKNSSVLSKIQSDERCTLYSSLIIGDSAEELYIA-SGSVFGEIIVWKPHEDNKPIRLKGHE 175 (967)
T ss_pred hhcceEEEEEcCceEEEEecccCceehhcCCCceEEEEeEEEEeccCcEEEEE-eccccccEEEEeccccCCcceecccC
Confidence 3444555554 5799999998877777666543221 1222 22233446777 599999999998874333 3589999
Q ss_pred cceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEe
Q 020784 259 SRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 259 ~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~ 318 (321)
+.|.++.|+-||+++||+|+|++ +|+|++.+++...-...||...+-...+...+|+++
T Consensus 176 G~iF~i~~s~dg~~i~s~SdDRs-iRlW~i~s~~~~~~~~fgHsaRvw~~~~~~n~i~t~ 234 (967)
T KOG0974|consen 176 GSIFSIVTSLDGRYIASVSDDRS-IRLWPIDSREVLGCTGFGHSARVWACCFLPNRIITV 234 (967)
T ss_pred CceEEEEEccCCcEEEEEecCcc-eeeeecccccccCcccccccceeEEEEeccceeEEe
Confidence 99999999999999999999999 999999999887733457776666555555576654
No 245
>KOG2314 consensus Translation initiation factor 3, subunit b (eIF-3b) [Translation, ribosomal structure and biogenesis]
Probab=98.82 E-value=5.1e-07 Score=84.06 Aligned_cols=225 Identities=13% Similarity=0.115 Sum_probs=135.3
Q ss_pred eEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCC----CCCcEEEEeC
Q 020784 88 LLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQY----PLNKVMIWDD 163 (321)
Q Consensus 88 V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~----~d~~v~iWD~ 163 (321)
=+.+.|||-|+||++=-..||.+|-=.....+.... ...+..+++++..++|++-+..-.... ....++|||+
T Consensus 213 etyv~wSP~GTYL~t~Hk~GI~lWGG~~f~r~~RF~---Hp~Vq~idfSP~EkYLVT~s~~p~~~~~~d~e~~~l~IWDI 289 (698)
T KOG2314|consen 213 ETYVRWSPKGTYLVTFHKQGIALWGGESFDRIQRFY---HPGVQFIDFSPNEKYLVTYSPEPIIVEEDDNEGQQLIIWDI 289 (698)
T ss_pred eeeEEecCCceEEEEEeccceeeecCccHHHHHhcc---CCCceeeecCCccceEEEecCCccccCcccCCCceEEEEEc
Confidence 467999999999999999999999766655543333 246888999999999887764322111 3377999999
Q ss_pred CCCcEEEEEeeC--C-cee-EEEEeC--CeEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeec--
Q 020784 164 HQSRCIGELSFR--S-EVR-SVKLRR--DRIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPG-- 235 (321)
Q Consensus 164 ~~~~~~~~~~~~--~-~v~-~v~~~~--~~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sG-- 235 (321)
.+|...+.|... . .+. -+.|+. +.++..+.+.|.||+..+..++-.-.. ...++-.|++.|..++||+=.
T Consensus 290 ~tG~lkrsF~~~~~~~~~WP~frWS~DdKy~Arm~~~sisIyEtpsf~lld~Ksl--ki~gIr~FswsP~~~llAYwtpe 367 (698)
T KOG2314|consen 290 ATGLLKRSFPVIKSPYLKWPIFRWSHDDKYFARMTGNSISIYETPSFMLLDKKSL--KISGIRDFSWSPTSNLLAYWTPE 367 (698)
T ss_pred cccchhcceeccCCCccccceEEeccCCceeEEeccceEEEEecCceeeeccccc--CCccccCcccCCCcceEEEEccc
Confidence 999988877652 1 121 234554 345555778999999876544321110 112233333333334444300
Q ss_pred ----------------CC------------------CC-c-------------------EEEEeeCCcceE-Eeeccccc
Q 020784 236 ----------------LQ------------------KG-Q-------------------VRVEHYASKRTK-FIMAHDSR 260 (321)
Q Consensus 236 ----------------s~------------------dg-~-------------------V~i~d~~~~~~~-~l~~H~~~ 260 (321)
.. .| . +.|..+..+.+- ..-.-+..
T Consensus 368 ~~~~parvtL~evPs~~~iRt~nlfnVsDckLhWQk~gdyLcvkvdR~tK~~~~g~f~n~eIfrireKdIpve~velke~ 447 (698)
T KOG2314|consen 368 TNNIPARVTLMEVPSKREIRTKNLFNVSDCKLHWQKSGDYLCVKVDRHTKSKVKGQFSNLEIFRIREKDIPVEVVELKES 447 (698)
T ss_pred ccCCcceEEEEecCccceeeeccceeeeccEEEeccCCcEEEEEEEeeccccccceEeeEEEEEeeccCCCceeeecchh
Confidence 00 00 1 111111111110 11123456
Q ss_pred eeEEEECCCCCEEEEEeCC--CcEEEEEEcCC----CcEEEEEeCCCcceeEEEeecCceEEEe
Q 020784 261 IACFALTQDGQLLATSSTK--GTLVRIFNTLD----GTLLQEECCPSISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 261 V~~vafspdg~~las~S~D--gt~IrIWd~~t----g~~i~~~~~g~~~~~~~~s~d~~~la~~ 318 (321)
|...+|-|.|..||+-+.. .+.++++.+++ -+++.++.. .....+.+++-|+|+++|
T Consensus 448 vi~FaWEP~gdkF~vi~g~~~k~tvsfY~~e~~~~~~~lVk~~dk-~~~N~vfwsPkG~fvvva 510 (698)
T KOG2314|consen 448 VIAFAWEPHGDKFAVISGNTVKNTVSFYAVETNIKKPSLVKELDK-KFANTVFWSPKGRFVVVA 510 (698)
T ss_pred eeeeeeccCCCeEEEEEccccccceeEEEeecCCCchhhhhhhcc-cccceEEEcCCCcEEEEE
Confidence 7888999999998876532 22388998873 245666643 333455889999999886
No 246
>PRK01029 tolB translocation protein TolB; Provisional
Probab=98.79 E-value=2.9e-06 Score=80.40 Aligned_cols=183 Identities=11% Similarity=0.068 Sum_probs=109.2
Q ss_pred eEEEEEecCCCeEEE--EeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCe--EEEEEC--C----EEEEE
Q 020784 130 IGVVEMLFRCNILAL--VGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDR--IIVVLE--Q----KIFVY 199 (321)
Q Consensus 130 v~~v~~~~~~~~~~~--~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~--~~~~~~--~----~I~iw 199 (321)
...=.|+++++.+++ ++... ....|.+.|+..++......+........|+++. ++...+ + .+.+|
T Consensus 187 ~~sP~wSPDG~~~~~~y~S~~~----g~~~I~~~~l~~g~~~~lt~~~g~~~~p~wSPDG~~Laf~s~~~g~~di~~~~~ 262 (428)
T PRK01029 187 SITPTWMHIGSGFPYLYVSYKL----GVPKIFLGSLENPAGKKILALQGNQLMPTFSPRKKLLAFISDRYGNPDLFIQSF 262 (428)
T ss_pred cccceEccCCCceEEEEEEccC----CCceEEEEECCCCCceEeecCCCCccceEECCCCCEEEEEECCCCCcceeEEEe
Confidence 344478888876433 44321 1246888898887755544555566677888764 444442 1 34457
Q ss_pred EcCC---cEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEee--C--CcceEEeeccccceeEEEECCCCCE
Q 020784 200 NFAD---LKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHY--A--SKRTKFIMAHDSRIACFALTQDGQL 272 (321)
Q Consensus 200 d~~~---~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~--~--~~~~~~l~~H~~~V~~vafspdg~~ 272 (321)
++.. ++..+............++ .+|+..|++....+|...||.+ . .+....+..+...+...+|||||++
T Consensus 263 ~~~~g~~g~~~~lt~~~~~~~~~p~w--SPDG~~Laf~s~~~g~~~ly~~~~~~~g~~~~~lt~~~~~~~~p~wSPDG~~ 340 (428)
T PRK01029 263 SLETGAIGKPRRLLNEAFGTQGNPSF--SPDGTRLVFVSNKDGRPRIYIMQIDPEGQSPRLLTKKYRNSSCPAWSPDGKK 340 (428)
T ss_pred ecccCCCCcceEeecCCCCCcCCeEE--CCCCCEEEEEECCCCCceEEEEECcccccceEEeccCCCCccceeECCCCCE
Confidence 7654 2322222222122223344 4566767765556676666543 2 2334556666677889999999999
Q ss_pred EEEEeCCC--cEEEEEEcCCCcEEEEEeCCC-cceeEEEeecCceEEEee
Q 020784 273 LATSSTKG--TLVRIFNTLDGTLLQEECCPS-ISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 273 las~S~Dg--t~IrIWd~~tg~~i~~~~~g~-~~~~~~~s~d~~~la~~~ 319 (321)
||..+.++ ..|.+||+.+|+... +..+. ......+++||++|++..
T Consensus 341 Laf~~~~~g~~~I~v~dl~~g~~~~-Lt~~~~~~~~p~wSpDG~~L~f~~ 389 (428)
T PRK01029 341 IAFCSVIKGVRQICVYDLATGRDYQ-LTTSPENKESPSWAIDSLHLVYSA 389 (428)
T ss_pred EEEEEcCCCCcEEEEEECCCCCeEE-ccCCCCCccceEECCCCCEEEEEE
Confidence 98776542 238999999998743 43332 223457889999988653
No 247
>KOG2394 consensus WD40 protein DMR-N9 [General function prediction only]
Probab=98.76 E-value=3.7e-08 Score=91.08 Aligned_cols=93 Identities=17% Similarity=0.168 Sum_probs=73.6
Q ss_pred CCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEe
Q 020784 84 PPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWD 162 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD 162 (321)
.++.|+..+|++||++||+-+.|| +||||.++.+.+....- --+...+|+|++|++++++.+ .|.-|.||.
T Consensus 289 ~~g~in~f~FS~DG~~LA~VSqDGfLRvF~fdt~eLlg~mkS-YFGGLLCvcWSPDGKyIvtGG-------EDDLVtVwS 360 (636)
T KOG2394|consen 289 GEGSINEFAFSPDGKYLATVSQDGFLRIFDFDTQELLGVMKS-YFGGLLCVCWSPDGKYIVTGG-------EDDLVTVWS 360 (636)
T ss_pred ccccccceeEcCCCceEEEEecCceEEEeeccHHHHHHHHHh-hccceEEEEEcCCccEEEecC-------CcceEEEEE
Confidence 345889999999999999999988 78999988765432220 137899999999999988877 567899999
Q ss_pred CCCCcEEEEEeeCC-ceeEEEEe
Q 020784 163 DHQSRCIGELSFRS-EVRSVKLR 184 (321)
Q Consensus 163 ~~~~~~~~~~~~~~-~v~~v~~~ 184 (321)
+..++.+..-+.|. -|..|+|.
T Consensus 361 f~erRVVARGqGHkSWVs~VaFD 383 (636)
T KOG2394|consen 361 FEERRVVARGQGHKSWVSVVAFD 383 (636)
T ss_pred eccceEEEeccccccceeeEeec
Confidence 99999888766554 46667766
No 248
>KOG1064 consensus RAVE (regulator of V-ATPase assembly) complex subunit RAV1/DMX protein, WD repeat superfamily [General function prediction only]
Probab=98.76 E-value=5.5e-08 Score=100.69 Aligned_cols=192 Identities=11% Similarity=0.195 Sum_probs=130.5
Q ss_pred CCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC
Q 020784 86 PTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH 164 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~ 164 (321)
..|+++.=+|...+-++|+.+| |++|....+..+..........+..+.++..++.+.++. .||.+-+|-..
T Consensus 2209 ~~v~r~~sHp~~~~Yltgs~dgsv~~~~w~~~~~v~~~rt~g~s~vtr~~f~~qGnk~~i~d-------~dg~l~l~q~~ 2281 (2439)
T KOG1064|consen 2209 ENVRRMTSHPSDPYYLTGSQDGSVRMFEWGHGQQVVCFRTAGNSRVTRSRFNHQGNKFGIVD-------GDGDLSLWQAS 2281 (2439)
T ss_pred CceeeecCCCCCceEEecCCCceEEEEeccCCCeEEEeeccCcchhhhhhhcccCCceeeec-------cCCceeecccC
Confidence 5788888888888888888877 779998777766554421224455556677788887776 46899999876
Q ss_pred CCcEEEEEeeC-CceeEEEEeCCeEEEEE---C-CEEEEEEcC---CcEEEEEEeccCCCCceEEEeeCCCceEEEeecC
Q 020784 165 QSRCIGELSFR-SEVRSVKLRRDRIIVVL---E-QKIFVYNFA---DLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGL 236 (321)
Q Consensus 165 ~~~~~~~~~~~-~~v~~v~~~~~~~~~~~---~-~~I~iwd~~---~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs 236 (321)
. +.....+.+ .....+.|-...++.++ + +.+.+||.. ...+++ ..|.....+.++.|. .+++. +|+
T Consensus 2282 p-k~~~s~qchnk~~~Df~Fi~s~~~tag~s~d~~n~~lwDtl~~~~~s~v~--~~H~~gaT~l~~~P~--~qlli-sgg 2355 (2439)
T KOG1064|consen 2282 P-KPYTSWQCHNKALSDFRFIGSLLATAGRSSDNRNVCLWDTLLPPMNSLVH--TCHDGGATVLAYAPK--HQLLI-SGG 2355 (2439)
T ss_pred C-cceeccccCCccccceeeeehhhhccccCCCCCcccchhcccCcccceee--eecCCCceEEEEcCc--ceEEE-ecC
Confidence 3 222222222 23344444443333332 2 489999973 234444 556555556666554 47776 799
Q ss_pred CCCcEEEEeeCCcce-EEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCC
Q 020784 237 QKGQVRVEHYASKRT-KFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPS 301 (321)
Q Consensus 237 ~dg~V~i~d~~~~~~-~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~ 301 (321)
.+|.|++||...+++ +++++ +. ...+|++|+..|. |+||++..-.+++++...|
T Consensus 2356 r~G~v~l~D~rqrql~h~~~~---------~~-~~~~f~~~ss~g~-ikIw~~s~~~ll~~~p~e~ 2410 (2439)
T KOG1064|consen 2356 RKGEVCLFDIRQRQLRHTFQA---------LD-TREYFVTGSSEGN-IKIWRLSEFGLLHTFPSEH 2410 (2439)
T ss_pred CcCcEEEeehHHHHHHHHhhh---------hh-hhheeeccCcccc-eEEEEccccchhhcCchhh
Confidence 999999999987653 45544 44 4678999999999 9999999998888886555
No 249
>KOG4497 consensus Uncharacterized conserved protein WDR8, contains WD repeats [General function prediction only]
Probab=98.74 E-value=4.8e-06 Score=73.23 Aligned_cols=229 Identities=10% Similarity=0.058 Sum_probs=139.4
Q ss_pred CCCCCeEEEEEcCCCCEEEEEcC-Cc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCC---------
Q 020784 83 SPPPTLLHISFNQDHGCFAAGTD-HG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDP--------- 151 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg~~lasg~~-~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~--------- 151 (321)
...+.+.+++|||||+.|..-++ +- +-||.+.+.+..+...- +..+..+++.+++...++++-.+..
T Consensus 89 eg~agls~~~WSPdgrhiL~tseF~lriTVWSL~t~~~~~~~~p--K~~~kg~~f~~dg~f~ai~sRrDCkdyv~i~~c~ 166 (447)
T KOG4497|consen 89 EGQAGLSSISWSPDGRHILLTSEFDLRITVWSLNTQKGYLLPHP--KTNVKGYAFHPDGQFCAILSRRDCKDYVQISSCK 166 (447)
T ss_pred cCCCcceeeeECCCcceEeeeecceeEEEEEEeccceeEEeccc--ccCceeEEECCCCceeeeeecccHHHHHHHHhhH
Confidence 34468999999999998887777 43 56999988776554432 5567888888899888877654320
Q ss_pred --------------------CCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeC-C-eEEEEE-CCEEEEEEcCCcEEE-
Q 020784 152 --------------------QYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRR-D-RIIVVL-EQKIFVYNFADLKLL- 207 (321)
Q Consensus 152 --------------------~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~-~-~~~~~~-~~~I~iwd~~~~~~~- 207 (321)
.=+++-+.|||.--.-.+...+..-.+..++|++ + .+++++ |+.+|+.|--+.+.+
T Consensus 167 ~W~ll~~f~~dT~DltgieWsPdg~~laVwd~~Leykv~aYe~~lG~k~v~wsP~~qflavGsyD~~lrvlnh~tWk~f~ 246 (447)
T KOG4497|consen 167 AWILLKEFKLDTIDLTGIEWSPDGNWLAVWDNVLEYKVYAYERGLGLKFVEWSPCNQFLAVGSYDQMLRVLNHFTWKPFG 246 (447)
T ss_pred HHHHHHhcCCCcccccCceECCCCcEEEEecchhhheeeeeeeccceeEEEeccccceEEeeccchhhhhhceeeeeehh
Confidence 1123558888843222222233334566777776 3 334443 345555442211111
Q ss_pred -----------------------------------------------------------EEEec---cCC---CCceEEE
Q 020784 208 -----------------------------------------------------------HQIET---IAN---PKGLCAV 222 (321)
Q Consensus 208 -----------------------------------------------------------~~l~~---~~~---~~~~~~~ 222 (321)
++++. ..+ .++..+|
T Consensus 247 eflhl~s~~dp~~~~~~ke~~~~~ql~~~cLsf~p~~~~a~~~~~se~~YE~~~~pv~~~~lkp~tD~pnPk~g~g~laf 326 (447)
T KOG4497|consen 247 EFLHLCSYHDPTLHLLEKETFSIVQLLHHCLSFTPTDLEAHIWEESETIYEQQMTPVKVHKLKPPTDFPNPKCGAGKLAF 326 (447)
T ss_pred hhccchhccCchhhhhhhhhcchhhhcccccccCCCccccCccccchhhhhhhhcceeeecccCCCCCCCcccccceeee
Confidence 11110 011 1224455
Q ss_pred eeCCCceEEEeecCCCC---cEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeC
Q 020784 223 SQGVGSLVLVCPGLQKG---QVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECC 299 (321)
Q Consensus 223 s~~~d~~~la~sGs~dg---~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~ 299 (321)
+. |..++|. ..|+ .+-+||++...+...-....+|+...|+|....|+.+-..-. +.+|...--.++..-..
T Consensus 327 s~--Ds~y~aT--rnd~~PnalW~Wdlq~l~l~avLiQk~piraf~WdP~~prL~vctg~sr-LY~W~psg~~~V~vP~~ 401 (447)
T KOG4497|consen 327 SC--DSTYAAT--RNDKYPNALWLWDLQNLKLHAVLIQKHPIRAFEWDPGRPRLVVCTGKSR-LYFWAPSGPRVVGVPKK 401 (447)
T ss_pred cC--CceEEee--ecCCCCceEEEEechhhhhhhhhhhccceeEEEeCCCCceEEEEcCCce-EEEEcCCCceEEecCCC
Confidence 54 5577774 3333 355599988887766667889999999999888877754444 88887765555554445
Q ss_pred CCcceeEEEeecCceEEEe
Q 020784 300 PSISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 300 g~~~~~~~~s~d~~~la~~ 318 (321)
|.....+..--+|.+|+++
T Consensus 402 GF~i~~l~W~~~g~~i~l~ 420 (447)
T KOG4497|consen 402 GFNIQKLQWLQPGEFIVLC 420 (447)
T ss_pred CceeeeEEecCCCcEEEEE
Confidence 5444455666777777664
No 250
>COG2706 3-carboxymuconate cyclase [Carbohydrate transport and metabolism]
Probab=98.73 E-value=5.4e-05 Score=67.50 Aligned_cols=225 Identities=17% Similarity=0.171 Sum_probs=140.5
Q ss_pred CCCeEEEEEcCCCCEEEEEcC----CcEEEEEecC--CceeEEeeee-cCCceEEEEEecCCCeEEEEeCCCCCCCCCCc
Q 020784 85 PPTLLHISFNQDHGCFAAGTD----HGFRIYNCDP--FREIFRRDFE-RGGGIGVVEMLFRCNILALVGGGPDPQYPLNK 157 (321)
Q Consensus 85 ~~~V~~v~fs~dg~~lasg~~----~gv~vw~~~~--~~~~~~~~~~-~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~ 157 (321)
.+..+-++|+|++++|.++.. .+|.-|.++. ++..+..... .+.+-..+++..++..++++. +.-+.
T Consensus 39 ~~nptyl~~~~~~~~LY~v~~~~~~ggvaay~iD~~~G~Lt~ln~~~~~g~~p~yvsvd~~g~~vf~An------Y~~g~ 112 (346)
T COG2706 39 LGNPTYLAVNPDQRHLYVVNEPGEEGGVAAYRIDPDDGRLTFLNRQTLPGSPPCYVSVDEDGRFVFVAN------YHSGS 112 (346)
T ss_pred cCCCceEEECCCCCEEEEEEecCCcCcEEEEEEcCCCCeEEEeeccccCCCCCeEEEECCCCCEEEEEE------ccCce
Confidence 346788999999999987754 3577888875 4433332211 233447788888888888776 34588
Q ss_pred EEEEeCCC-CcE---EEEEeeCCc----------eeEEEEeCCe-EEEEE---CCEEEEEEcCCcEEEEEE----eccCC
Q 020784 158 VMIWDDHQ-SRC---IGELSFRSE----------VRSVKLRRDR-IIVVL---EQKIFVYNFADLKLLHQI----ETIAN 215 (321)
Q Consensus 158 v~iWD~~~-~~~---~~~~~~~~~----------v~~v~~~~~~-~~~~~---~~~I~iwd~~~~~~~~~l----~~~~~ 215 (321)
|.++-++. |.. +..+.+.+. +-...+.++. .+++. .++|.+|++..+++...- +....
T Consensus 113 v~v~p~~~dG~l~~~v~~~~h~g~~p~~rQ~~~h~H~a~~tP~~~~l~v~DLG~Dri~~y~~~dg~L~~~~~~~v~~G~G 192 (346)
T COG2706 113 VSVYPLQADGSLQPVVQVVKHTGSGPHERQESPHVHSANFTPDGRYLVVPDLGTDRIFLYDLDDGKLTPADPAEVKPGAG 192 (346)
T ss_pred EEEEEcccCCccccceeeeecCCCCCCccccCCccceeeeCCCCCEEEEeecCCceEEEEEcccCccccccccccCCCCC
Confidence 99998865 432 233333322 5666677765 33333 369999999877653322 22222
Q ss_pred CCceEEEeeCCCceEEEeecCCCCcEEEEeeCC--cceEEeecc---------ccceeEEEECCCCCEEEEEeCCCcEEE
Q 020784 216 PKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYAS--KRTKFIMAH---------DSRIACFALTQDGQLLATSSTKGTLVR 284 (321)
Q Consensus 216 ~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~--~~~~~l~~H---------~~~V~~vafspdg~~las~S~Dgt~Ir 284 (321)
+ .-+.|++++.-.++ ..--+++|.+|.+.. +.+..++-| ......|.+++||++|-.+-.--..|-
T Consensus 193 P-RHi~FHpn~k~aY~--v~EL~stV~v~~y~~~~g~~~~lQ~i~tlP~dF~g~~~~aaIhis~dGrFLYasNRg~dsI~ 269 (346)
T COG2706 193 P-RHIVFHPNGKYAYL--VNELNSTVDVLEYNPAVGKFEELQTIDTLPEDFTGTNWAAAIHISPDGRFLYASNRGHDSIA 269 (346)
T ss_pred c-ceEEEcCCCcEEEE--EeccCCEEEEEEEcCCCceEEEeeeeccCccccCCCCceeEEEECCCCCEEEEecCCCCeEE
Confidence 2 23556665543344 468899999988775 344444333 345678899999999886643222488
Q ss_pred EEEcCC--CcEE--EEE-eCCCcceeEEEeecCceEEEe
Q 020784 285 IFNTLD--GTLL--QEE-CCPSISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 285 IWd~~t--g~~i--~~~-~~g~~~~~~~~s~d~~~la~~ 318 (321)
+|.+.. |++- ... ..|.......+++++++|.+|
T Consensus 270 ~f~V~~~~g~L~~~~~~~teg~~PR~F~i~~~g~~Liaa 308 (346)
T COG2706 270 VFSVDPDGGKLELVGITPTEGQFPRDFNINPSGRFLIAA 308 (346)
T ss_pred EEEEcCCCCEEEEEEEeccCCcCCccceeCCCCCEEEEE
Confidence 887753 4432 222 233335556888999999876
No 251
>COG5354 Uncharacterized protein, contains Trp-Asp (WD) repeat [General function prediction only]
Probab=98.72 E-value=2.3e-06 Score=79.04 Aligned_cols=223 Identities=12% Similarity=0.082 Sum_probs=130.5
Q ss_pred CCeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCC-------C-CCCCCc
Q 020784 86 PTLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPD-------P-QYPLNK 157 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~-------~-~~~d~~ 157 (321)
-++..++|||.|++|++....+|.+|.-.....+.... ...|..+.+++.+++|.+-+-... . ...++.
T Consensus 33 ~p~~~~~~SP~G~~l~~~~~~~V~~~~g~~~~~l~~~~---~~~V~~~~fSP~~kYL~tw~~~pi~~pe~e~sp~~~~n~ 109 (561)
T COG5354 33 WPVAYVSESPLGTYLFSEHAAGVECWGGPSKAKLVRFR---HPDVKYLDFSPNEKYLVTWSREPIIEPEIEISPFTSKNN 109 (561)
T ss_pred cchhheeecCcchheehhhccceEEccccchhheeeee---cCCceecccCcccceeeeeccCCccChhhccCCccccCc
Confidence 47889999999999999999999999877766443333 356777788888887765432111 1 123468
Q ss_pred EEEEeCCCCcEEEEEeeCCce---e-EEEEeCCeEEE--EECCEEEEEEcCC-cEE--EEEEeccCCCCce--EEEeeCC
Q 020784 158 VMIWDDHQSRCIGELSFRSEV---R-SVKLRRDRIIV--VLEQKIFVYNFAD-LKL--LHQIETIANPKGL--CAVSQGV 226 (321)
Q Consensus 158 v~iWD~~~~~~~~~~~~~~~v---~-~v~~~~~~~~~--~~~~~I~iwd~~~-~~~--~~~l~~~~~~~~~--~~~s~~~ 226 (321)
+.+||..+|..+..+...... . -+.|+.+..++ ...+.++|+++.. ... .+.+. +.++ .++++.+
T Consensus 110 ~~vwd~~sg~iv~sf~~~~q~~~~Wp~~k~s~~D~y~ARvv~~sl~i~e~t~n~~~~p~~~lr----~~gi~dFsisP~~ 185 (561)
T COG5354 110 VFVWDIASGMIVFSFNGISQPYLGWPVLKFSIDDKYVARVVGSSLYIHEITDNIEEHPFKNLR----PVGILDFSISPEG 185 (561)
T ss_pred eeEEeccCceeEeeccccCCcccccceeeeeecchhhhhhccCeEEEEecCCccccCchhhcc----ccceeeEEecCCC
Confidence 999999999999887654422 2 24454433222 3556778887521 110 11111 1122 2223322
Q ss_pred CceEEEe----ecCCCCcEEEE-----------------------------------------------------eeCCc
Q 020784 227 GSLVLVC----PGLQKGQVRVE-----------------------------------------------------HYASK 249 (321)
Q Consensus 227 d~~~la~----sGs~dg~V~i~-----------------------------------------------------d~~~~ 249 (321)
++..||+ -+...++++|| +++.+
T Consensus 186 n~~~la~~tPEk~~kpa~~~i~sIp~~s~l~tk~lfk~~~~qLkW~~~g~~ll~l~~t~~ksnKsyfgesnLyl~~~~e~ 265 (561)
T COG5354 186 NHDELAYWTPEKLNKPAMVRILSIPKNSVLVTKNLFKVSGVQLKWQVLGKYLLVLVMTHTKSNKSYFGESNLYLLRITER 265 (561)
T ss_pred CCceEEEEccccCCCCcEEEEEEccCCCeeeeeeeEeecccEEEEecCCceEEEEEEEeeecccceeccceEEEEeeccc
Confidence 2222222 11223333333 22222
Q ss_pred ceEEeeccccceeEEEECCCCCEEEEEe--CCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEe
Q 020784 250 RTKFIMAHDSRIACFALTQDGQLLATSS--TKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 250 ~~~~l~~H~~~V~~vafspdg~~las~S--~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~ 318 (321)
.+.+...-.++|...+|.|.+..|++.+ ++-+ +.++|++.. +..-+. ......+.|++.++|+.+|
T Consensus 266 ~i~V~~~~~~pVhdf~W~p~S~~F~vi~g~~pa~-~s~~~lr~N-l~~~~P-e~~rNT~~fsp~~r~il~a 333 (561)
T COG5354 266 SIPVEKDLKDPVHDFTWEPLSSRFAVISGYMPAS-VSVFDLRGN-LRFYFP-EQKRNTIFFSPHERYILFA 333 (561)
T ss_pred ccceeccccccceeeeecccCCceeEEecccccc-eeecccccc-eEEecC-CcccccccccCcccEEEEe
Confidence 2223334578899999999999888876 6777 999999865 443332 2223344666777776553
No 252
>KOG1272 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=98.71 E-value=1.2e-08 Score=92.79 Aligned_cols=185 Identities=14% Similarity=0.133 Sum_probs=132.8
Q ss_pred CCeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCC
Q 020784 86 PTLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQ 165 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~ 165 (321)
..|+.+.|-.+.++||++-.+-+.|||-+-.+....+. ...+..+++.+---+++.++ ..|-++--|+.+
T Consensus 171 Etv~Dv~~LHneq~~AVAQK~y~yvYD~~GtElHClk~---~~~v~rLeFLPyHfLL~~~~-------~~G~L~Y~DVS~ 240 (545)
T KOG1272|consen 171 ETVRDVTFLHNEQFFAVAQKKYVYVYDNNGTELHCLKR---HIRVARLEFLPYHFLLVAAS-------EAGFLKYQDVST 240 (545)
T ss_pred hhhhhhhhhcchHHHHhhhhceEEEecCCCcEEeehhh---cCchhhhcccchhheeeecc-------cCCceEEEeech
Confidence 37888888889999999988888899865443322222 35666777765444444444 458899999999
Q ss_pred CcEEEEEeeC-CceeEEEEeCCeEEEEE---CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcE
Q 020784 166 SRCIGELSFR-SEVRSVKLRRDRIIVVL---EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQV 241 (321)
Q Consensus 166 ~~~~~~~~~~-~~v~~v~~~~~~~~~~~---~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V 241 (321)
|+.+..+... +.+..++.+|-.-++.. .++|.+|.....+.+.++..|..++..+++.. +|.++|+ .+.|..|
T Consensus 241 GklVa~~~t~~G~~~vm~qNP~NaVih~GhsnGtVSlWSP~skePLvKiLcH~g~V~siAv~~--~G~YMaT-tG~Dr~~ 317 (545)
T KOG1272|consen 241 GKLVASIRTGAGRTDVMKQNPYNAVIHLGHSNGTVSLWSPNSKEPLVKILCHRGPVSSIAVDR--GGRYMAT-TGLDRKV 317 (545)
T ss_pred hhhhHHHHccCCccchhhcCCccceEEEcCCCceEEecCCCCcchHHHHHhcCCCcceEEECC--CCcEEee-cccccce
Confidence 9998887654 46666777775544443 36999999999898888999988887777755 5599995 7778899
Q ss_pred EEEeeCCc-ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEE
Q 020784 242 RVEHYASK-RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 242 ~i~d~~~~-~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd 287 (321)
+|||+..- .+.++.. ......++||..|- || +|.... |.||.
T Consensus 318 kIWDlR~~~ql~t~~t-p~~a~~ls~Sqkgl-LA-~~~G~~-v~iw~ 360 (545)
T KOG1272|consen 318 KIWDLRNFYQLHTYRT-PHPASNLSLSQKGL-LA-LSYGDH-VQIWK 360 (545)
T ss_pred eEeeeccccccceeec-CCCccccccccccc-ee-eecCCe-eeeeh
Confidence 99998753 3444433 45678899997664 44 444445 99993
No 253
>KOG4532 consensus WD40-like repeat containing protein [General function prediction only]
Probab=98.70 E-value=5.3e-06 Score=71.07 Aligned_cols=201 Identities=13% Similarity=0.075 Sum_probs=116.3
Q ss_pred EEEEEcCC-----CCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCC-CeEEEEeCCCCCCCCCCcEEEE
Q 020784 89 LHISFNQD-----HGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRC-NILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 89 ~~v~fs~d-----g~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~-~~~~~~sg~~~~~~~d~~v~iW 161 (321)
+.+.|.|- -.+||.|+..| +.+|.+.+........-.|..+|..+.-.-+. .-+.+++ .|+++|+.
T Consensus 71 ~g~~F~p~s~~~kc~~la~gG~~g~fd~~~~~tn~~h~~~cd~snn~v~~~~r~cd~~~~~~i~s-------ndht~k~~ 143 (344)
T KOG4532|consen 71 TGMTFTPGSFINKCVTLADGGASGQFDLFACNTNDGHLYQCDVSNNDVTLVKRYCDLKFPLNIAS-------NDHTGKTM 143 (344)
T ss_pred ecccccchHhhccccEEEeccccceeeeecccCcccceeeecccccchhhhhhhcccccceeecc-------CCcceeEE
Confidence 34566662 34788887755 77999886654333221123333332211111 1233444 68999999
Q ss_pred eCCCCcEEEEEeeC-CceeEEEEeCC--eEEEEEC-CEEEEEEcCC-cEEEEEEeccCCCCceEEEeeCCCceEEEeecC
Q 020784 162 DDHQSRCIGELSFR-SEVRSVKLRRD--RIIVVLE-QKIFVYNFAD-LKLLHQIETIANPKGLCAVSQGVGSLVLVCPGL 236 (321)
Q Consensus 162 D~~~~~~~~~~~~~-~~v~~v~~~~~--~~~~~~~-~~I~iwd~~~-~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs 236 (321)
++.-+......... -.+.++..+++ ..+++.+ ..|..|.+.. .+.+..+..........+.++......+|+ ++
T Consensus 144 ~~~~~s~~~~~h~~~~~~ns~~~snd~~~~~~Vgds~~Vf~y~id~~sey~~~~~~a~t~D~gF~~S~s~~~~~FAv-~~ 222 (344)
T KOG4532|consen 144 VVSGDSNKFAVHNQNLTQNSLHYSNDPSWGSSVGDSRRVFRYAIDDESEYIENIYEAPTSDHGFYNSFSENDLQFAV-VF 222 (344)
T ss_pred EEecCcccceeeccccceeeeEEcCCCceEEEecCCCcceEEEeCCccceeeeeEecccCCCceeeeeccCcceEEE-Ee
Confidence 98765443333333 23556666654 4455555 5999999843 333323222222223334444445577774 99
Q ss_pred CCCcEEEEeeCCcc-eE-----EeeccccceeEEEECCCCCE-EEEEeCCCcEEEEEEcCCCcEEEEE
Q 020784 237 QKGQVRVEHYASKR-TK-----FIMAHDSRIACFALTQDGQL-LATSSTKGTLVRIFNTLDGTLLQEE 297 (321)
Q Consensus 237 ~dg~V~i~d~~~~~-~~-----~l~~H~~~V~~vafspdg~~-las~S~Dgt~IrIWd~~tg~~i~~~ 297 (321)
.||++.|||.+... .+ +-..|++.++.+.|++-|.+ |.--|+.-..+.|-|+++++..+..
T Consensus 223 Qdg~~~I~DVR~~~tpm~~~sstrp~hnGa~R~c~Fsl~g~lDLLf~sEhfs~~hv~D~R~~~~~q~I 290 (344)
T KOG4532|consen 223 QDGTCAIYDVRNMATPMAEISSTRPHHNGAFRVCRFSLYGLLDLLFISEHFSRVHVVDTRNYVNHQVI 290 (344)
T ss_pred cCCcEEEEEecccccchhhhcccCCCCCCceEEEEecCCCcceEEEEecCcceEEEEEcccCceeeEE
Confidence 99999999987532 11 33458999999999986642 2223443335999999998765543
No 254
>PLN02919 haloacid dehalogenase-like hydrolase family protein
Probab=98.69 E-value=1.3e-05 Score=83.74 Aligned_cols=197 Identities=12% Similarity=0.055 Sum_probs=117.9
Q ss_pred eEEEEEcCCCCEEEEEcC--CcEEEEEecCCceeEEeeee------cCC---------ceEEEEEecCCCeEEEEeCCCC
Q 020784 88 LLHISFNQDHGCFAAGTD--HGFRIYNCDPFREIFRRDFE------RGG---------GIGVVEMLFRCNILALVGGGPD 150 (321)
Q Consensus 88 V~~v~fs~dg~~lasg~~--~gv~vw~~~~~~~~~~~~~~------~~~---------~v~~v~~~~~~~~~~~~sg~~~ 150 (321)
-..|+|++++..|.++.. +.|+++|..+.......... .++ .-..+++.++...+.++..
T Consensus 626 P~GIavd~~gn~LYVaDt~n~~Ir~id~~~~~V~tlag~G~~g~~~~gg~~~~~~~ln~P~gVa~dp~~g~LyVad~--- 702 (1057)
T PLN02919 626 PQGLAYNAKKNLLYVADTENHALREIDFVNETVRTLAGNGTKGSDYQGGKKGTSQVLNSPWDVCFEPVNEKVYIAMA--- 702 (1057)
T ss_pred CcEEEEeCCCCEEEEEeCCCceEEEEecCCCEEEEEeccCcccCCCCCChhhhHhhcCCCeEEEEecCCCeEEEEEC---
Confidence 467889988876655543 45788887665432110000 000 0123566664444444432
Q ss_pred CCCCCCcEEEEeCCCCcEEEEEeeC----------------CceeEEEEeCC--eEEEEE--CCEEEEEEcCCcEEEEEE
Q 020784 151 PQYPLNKVMIWDDHQSRCIGELSFR----------------SEVRSVKLRRD--RIIVVL--EQKIFVYNFADLKLLHQI 210 (321)
Q Consensus 151 ~~~~d~~v~iWD~~~~~~~~~~~~~----------------~~v~~v~~~~~--~~~~~~--~~~I~iwd~~~~~~~~~l 210 (321)
.++.|++||..++.... +... ..+..++++++ .++++. ++.|++||+.++......
T Consensus 703 ---~~~~I~v~d~~~g~v~~-~~G~G~~~~~~g~~~~~~~~~~P~GIavspdG~~LYVADs~n~~Irv~D~~tg~~~~~~ 778 (1057)
T PLN02919 703 ---GQHQIWEYNISDGVTRV-FSGDGYERNLNGSSGTSTSFAQPSGISLSPDLKELYIADSESSSIRALDLKTGGSRLLA 778 (1057)
T ss_pred ---CCCeEEEEECCCCeEEE-EecCCccccCCCCccccccccCccEEEEeCCCCEEEEEECCCCeEEEEECCCCcEEEEE
Confidence 35889999988765431 1110 13556888875 366664 369999999765432111
Q ss_pred ecc-------------CCC------CceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEEeec--------------c
Q 020784 211 ETI-------------ANP------KGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKFIMA--------------H 257 (321)
Q Consensus 211 ~~~-------------~~~------~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~--------------H 257 (321)
.+. ... ..-..+..++++.+++ +...++.|++||..++.+.++.+ +
T Consensus 779 gg~~~~~~~l~~fG~~dG~g~~~~l~~P~Gvavd~dG~LYV-ADs~N~rIrviD~~tg~v~tiaG~G~~G~~dG~~~~a~ 857 (1057)
T PLN02919 779 GGDPTFSDNLFKFGDHDGVGSEVLLQHPLGVLCAKDGQIYV-ADSYNHKIKKLDPATKRVTTLAGTGKAGFKDGKALKAQ 857 (1057)
T ss_pred ecccccCcccccccCCCCchhhhhccCCceeeEeCCCcEEE-EECCCCEEEEEECCCCeEEEEeccCCcCCCCCcccccc
Confidence 000 000 0012333344556555 37788999999987766554433 2
Q ss_pred ccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcE
Q 020784 258 DSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTL 293 (321)
Q Consensus 258 ~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~ 293 (321)
-.....|+++++|+++++-+.+++ ||+||+.+++.
T Consensus 858 l~~P~GIavd~dG~lyVaDt~Nn~-Irvid~~~~~~ 892 (1057)
T PLN02919 858 LSEPAGLALGENGRLFVADTNNSL-IRYLDLNKGEA 892 (1057)
T ss_pred cCCceEEEEeCCCCEEEEECCCCE-EEEEECCCCcc
Confidence 236889999999999998888888 99999999876
No 255
>KOG3914 consensus WD repeat protein WDR4 [Function unknown]
Probab=98.69 E-value=3.5e-07 Score=81.99 Aligned_cols=84 Identities=23% Similarity=0.277 Sum_probs=61.9
Q ss_pred eccCCCCceEEEeeCCCceEEEeecCCCCcEEEEee-CCcceE-EeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEc
Q 020784 211 ETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHY-ASKRTK-FIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 211 ~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~-~~~~~~-~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~ 288 (321)
-+|-....-+++++++ .+++ +.+.|+.|+|-.+ ....+. -.-||+.-|..++.-++ +.|+|||-|++ ||+||+
T Consensus 148 lGhvSml~dVavS~D~--~~Ii-taDRDEkIRvs~ypa~f~IesfclGH~eFVS~isl~~~-~~LlS~sGD~t-lr~Wd~ 222 (390)
T KOG3914|consen 148 LGHVSMLLDVAVSPDD--QFII-TADRDEKIRVSRYPATFVIESFCLGHKEFVSTISLTDN-YLLLSGSGDKT-LRLWDI 222 (390)
T ss_pred hhhhhhhheeeecCCC--CEEE-EecCCceEEEEecCcccchhhhccccHhheeeeeeccC-ceeeecCCCCc-EEEEec
Confidence 3444444455666654 6666 4899999999333 333343 45689999999999865 55899999999 999999
Q ss_pred CCCcEEEEEeC
Q 020784 289 LDGTLLQEECC 299 (321)
Q Consensus 289 ~tg~~i~~~~~ 299 (321)
.+|++++++..
T Consensus 223 ~sgk~L~t~dl 233 (390)
T KOG3914|consen 223 TSGKLLDTCDL 233 (390)
T ss_pred ccCCcccccch
Confidence 99999988753
No 256
>PF15492 Nbas_N: Neuroblastoma-amplified sequence, N terminal
Probab=98.69 E-value=2.1e-05 Score=68.15 Aligned_cols=200 Identities=15% Similarity=0.169 Sum_probs=122.4
Q ss_pred EEEcCCCCEEEEEcCCcEEEEEec-CCcee-EEeeee--cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCC
Q 020784 91 ISFNQDHGCFAAGTDHGFRIYNCD-PFREI-FRRDFE--RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQS 166 (321)
Q Consensus 91 v~fs~dg~~lasg~~~gv~vw~~~-~~~~~-~~~~~~--~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~ 166 (321)
++.+.||++||.--+..+.|=... ....+ .+.... ..-.=+.++|++++.++|.+. +.|+|+++|+...
T Consensus 3 ~~~~~~Gk~lAi~qd~~iEiRsa~Ddf~si~~kcqVpkD~~PQWRkl~WSpD~tlLa~a~-------S~G~i~vfdl~g~ 75 (282)
T PF15492_consen 3 LALSSDGKLLAILQDQCIEIRSAKDDFSSIIGKCQVPKDPNPQWRKLAWSPDCTLLAYAE-------STGTIRVFDLMGS 75 (282)
T ss_pred eeecCCCcEEEEEeccEEEEEeccCCchheeEEEecCCCCCchheEEEECCCCcEEEEEc-------CCCeEEEEecccc
Confidence 567889999998877666555432 22211 111110 112346789999999999988 4599999998653
Q ss_pred cEEEEEe--------eCCceeEEEEeC---------CeEEEEECCEEEEEEc-----CCcEEEEEEeccC-CCCceEEEe
Q 020784 167 RCIGELS--------FRSEVRSVKLRR---------DRIIVVLEQKIFVYNF-----ADLKLLHQIETIA-NPKGLCAVS 223 (321)
Q Consensus 167 ~~~~~~~--------~~~~v~~v~~~~---------~~~~~~~~~~I~iwd~-----~~~~~~~~l~~~~-~~~~~~~~s 223 (321)
.+ ..+. ....|..+.|-. +.+++.-.+.++-|-+ ...+..++|.... .+.++.++.
T Consensus 76 ~l-f~I~p~~~~~~d~~~Aiagl~Fl~~~~s~~ws~ELlvi~Y~G~L~Sy~vs~gt~q~y~e~hsfsf~~~yp~Gi~~~v 154 (282)
T PF15492_consen 76 EL-FVIPPAMSFPGDLSDAIAGLIFLEYKKSAQWSYELLVINYRGQLRSYLVSVGTNQGYQENHSFSFSSHYPHGINSAV 154 (282)
T ss_pred ee-EEcCcccccCCccccceeeeEeeccccccccceeEEEEeccceeeeEEEEcccCCcceeeEEEEecccCCCceeEEE
Confidence 32 2221 112355555532 2233335667776664 2345556665432 255677777
Q ss_pred eCCCceEEEeecCCCCc----------EEEEeeCCc------------------------ceEE---e---eccccceeE
Q 020784 224 QGVGSLVLVCPGLQKGQ----------VRVEHYASK------------------------RTKF---I---MAHDSRIAC 263 (321)
Q Consensus 224 ~~~d~~~la~sGs~dg~----------V~i~d~~~~------------------------~~~~---l---~~H~~~V~~ 263 (321)
.++..++|.+.|..... +.-|.+-.+ .+.. + ..-...|..
T Consensus 155 y~p~h~LLlVgG~~~~~~~~s~a~~~GLtaWRiL~~~Pyyk~v~~~~~~~~~~~~~~~~~~~~~~~~fs~~~~~~d~i~k 234 (282)
T PF15492_consen 155 YHPKHRLLLVGGCEQNQDGMSKASSCGLTAWRILSDSPYYKQVTSSEDDITASSKRRGLLRIPSFKFFSRQGQEQDGIFK 234 (282)
T ss_pred EcCCCCEEEEeccCCCCCccccccccCceEEEEcCCCCcEEEccccCccccccccccceeeccceeeeeccccCCCceEE
Confidence 77777777776654332 222442110 0001 1 123567999
Q ss_pred EEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeC
Q 020784 264 FALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECC 299 (321)
Q Consensus 264 vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~ 299 (321)
|.+||||.+||+...+|. |-+|++.+.++.++...
T Consensus 235 mSlSPdg~~La~ih~sG~-lsLW~iPsL~~~~~W~~ 269 (282)
T PF15492_consen 235 MSLSPDGSLLACIHFSGS-LSLWEIPSLRLQRSWKQ 269 (282)
T ss_pred EEECCCCCEEEEEEcCCe-EEEEecCcchhhcccch
Confidence 999999999999999999 99999999888877643
No 257
>KOG0974 consensus WD-repeat protein WDR6, WD repeat superfamily [General function prediction only]
Probab=98.65 E-value=9.2e-07 Score=87.60 Aligned_cols=187 Identities=11% Similarity=0.085 Sum_probs=123.5
Q ss_pred EEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeecCCce---EEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCC
Q 020784 91 ISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGI---GVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQS 166 (321)
Q Consensus 91 v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v---~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~ 166 (321)
..+..+.+.++.+.. +.+.+||............ .... .++-+-...+.+.+.+|. .-+.|.+|+....
T Consensus 93 ~~l~~e~k~i~l~~~~ns~~i~d~~~~~~~~~i~~--~er~~l~~~~~~g~s~~~~~i~~gs-----v~~~iivW~~~~d 165 (967)
T KOG0974|consen 93 AKLFEENKKIALVTSRNSLLIRDSKNSSVLSKIQS--DERCTLYSSLIIGDSAEELYIASGS-----VFGEIIVWKPHED 165 (967)
T ss_pred cchhhhcceEEEEEcCceEEEEecccCceehhcCC--CceEEEEeEEEEeccCcEEEEEecc-----ccccEEEEecccc
Confidence 445555556665554 5677888765544333221 1111 111222334444444443 3489999998632
Q ss_pred -cEEEEEeeCCceeEEEEe--CCeEEEEECC-EEEEEEcCCcEEEE-EEeccCCCCceEEEeeCCCceEEEeecCCCCcE
Q 020784 167 -RCIGELSFRSEVRSVKLR--RDRIIVVLEQ-KIFVYNFADLKLLH-QIETIANPKGLCAVSQGVGSLVLVCPGLQKGQV 241 (321)
Q Consensus 167 -~~~~~~~~~~~v~~v~~~--~~~~~~~~~~-~I~iwd~~~~~~~~-~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V 241 (321)
..++..-+.+.+..+.++ ...++.++++ .+|+|++.+.+... +.-+|. ..+......+. .++ +++.|-+.
T Consensus 166 n~p~~l~GHeG~iF~i~~s~dg~~i~s~SdDRsiRlW~i~s~~~~~~~~fgHs--aRvw~~~~~~n--~i~-t~gedctc 240 (967)
T KOG0974|consen 166 NKPIRLKGHEGSIFSIVTSLDGRYIASVSDDRSIRLWPIDSREVLGCTGFGHS--ARVWACCFLPN--RII-TVGEDCTC 240 (967)
T ss_pred CCcceecccCCceEEEEEccCCcEEEEEecCcceeeeecccccccCccccccc--ceeEEEEeccc--eeE-EeccceEE
Confidence 233344456689999985 4456666765 99999998877655 333343 34444444432 454 58999999
Q ss_pred EEEeeCCcceEEeecccc-ceeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 242 RVEHYASKRTKFIMAHDS-RIACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 242 ~i~d~~~~~~~~l~~H~~-~V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
++|+.....+.++++|.. .+..++..++....+|++.|++ +|+||+..
T Consensus 241 rvW~~~~~~l~~y~~h~g~~iw~~~~~~~~~~~vT~g~Ds~-lk~~~l~~ 289 (967)
T KOG0974|consen 241 RVWGVNGTQLEVYDEHSGKGIWKIAVPIGVIIKVTGGNDST-LKLWDLNG 289 (967)
T ss_pred EEEecccceehhhhhhhhcceeEEEEcCCceEEEeeccCcc-hhhhhhhc
Confidence 999888777778999865 5999999999999999999999 99999875
No 258
>KOG1832 consensus HIV-1 Vpr-binding protein [Cell cycle control, cell division, chromosome partitioning]
Probab=98.63 E-value=1.8e-08 Score=97.99 Aligned_cols=209 Identities=11% Similarity=0.088 Sum_probs=141.6
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
+.+...-+|++|+-+.++|+.|+..| +++|++.++..+-+..+ |+..+..++-+.++..+.+.+.. +.--..+
T Consensus 1098 rd~~~~fTc~afs~~~~hL~vG~~~Geik~~nv~sG~~e~s~nc-H~SavT~vePs~dgs~~Ltsss~-----S~PlsaL 1171 (1516)
T KOG1832|consen 1098 RDETALFTCIAFSGGTNHLAVGSHAGEIKIFNVSSGSMEESVNC-HQSAVTLVEPSVDGSTQLTSSSS-----SSPLSAL 1171 (1516)
T ss_pred hccccceeeEEeecCCceEEeeeccceEEEEEccCccccccccc-cccccccccccCCcceeeeeccc-----cCchHHH
Confidence 44567889999999999999999966 88999999987766666 78899999988888887776632 2335789
Q ss_pred EeCCC-CcEEEEEeeCCceeEEEEeCC--eEEEE-ECCEEEEEEcCCcEEEEEEeccC---C-CCceEEEeeCCCceEEE
Q 020784 161 WDDHQ-SRCIGELSFRSEVRSVKLRRD--RIIVV-LEQKIFVYNFADLKLLHQIETIA---N-PKGLCAVSQGVGSLVLV 232 (321)
Q Consensus 161 WD~~~-~~~~~~~~~~~~v~~v~~~~~--~~~~~-~~~~I~iwd~~~~~~~~~l~~~~---~-~~~~~~~s~~~d~~~la 232 (321)
|++.. ++..+.+...+ ++.|++. .-+++ ..+...+||++++..+.++-... + ...+..|+|. ..++.
T Consensus 1172 W~~~s~~~~~Hsf~ed~---~vkFsn~~q~r~~gt~~d~a~~YDvqT~~~l~tylt~~~~~~y~~n~a~FsP~--D~LIl 1246 (1516)
T KOG1832|consen 1172 WDASSTGGPRHSFDEDK---AVKFSNSLQFRALGTEADDALLYDVQTCSPLQTYLTDTVTSSYSNNLAHFSPC--DTLIL 1246 (1516)
T ss_pred hccccccCccccccccc---eeehhhhHHHHHhcccccceEEEecccCcHHHHhcCcchhhhhhccccccCCC--cceEe
Confidence 99863 44444554433 4556543 22333 34689999999988777743211 1 1234445554 34443
Q ss_pred eecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeec
Q 020784 233 CPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLS 311 (321)
Q Consensus 233 ~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d 311 (321)
.||. +||..... ++.|...+..+. =.|+|+|.-++--| -|||++|.+++++.. .-+.+.+.|...
T Consensus 1247 ----ndGv--LWDvR~~~aIh~FD~ft~~~~-G~FHP~g~eVIINS------EIwD~RTF~lLh~VP-~Ldqc~VtFNst 1312 (1516)
T KOG1832|consen 1247 ----NDGV--LWDVRIPEAIHRFDQFTDYGG-GGFHPSGNEVIINS------EIWDMRTFKLLHSVP-SLDQCAVTFNST 1312 (1516)
T ss_pred ----eCce--eeeeccHHHHhhhhhheeccc-ccccCCCceEEeec------hhhhhHHHHHHhcCc-cccceEEEeccC
Confidence 4553 38876543 556665553333 35999999888654 389999999998874 455677777777
Q ss_pred CceE
Q 020784 312 SAWL 315 (321)
Q Consensus 312 ~~~l 315 (321)
|..+
T Consensus 1313 G~Vm 1316 (1516)
T KOG1832|consen 1313 GDVM 1316 (1516)
T ss_pred ccch
Confidence 7544
No 259
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=98.61 E-value=9.5e-05 Score=67.71 Aligned_cols=199 Identities=13% Similarity=0.053 Sum_probs=110.8
Q ss_pred EEEEcCCCCEEEEEcC---CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeC-CC
Q 020784 90 HISFNQDHGCFAAGTD---HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDD-HQ 165 (321)
Q Consensus 90 ~v~fs~dg~~lasg~~---~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~-~~ 165 (321)
..++++||++|..... ..|-|.|+.+.+.+..... .+...... ..+...++.+. |+.....-. .+
T Consensus 109 ~~~ls~dgk~l~V~n~~p~~~V~VvD~~~~kvv~ei~v--p~~~~vy~-t~e~~~~~~~~--------Dg~~~~v~~d~~ 177 (352)
T TIGR02658 109 MTSLTPDNKTLLFYQFSPSPAVGVVDLEGKAFVRMMDV--PDCYHIFP-TANDTFFMHCR--------DGSLAKVGYGTK 177 (352)
T ss_pred eEEECCCCCEEEEecCCCCCEEEEEECCCCcEEEEEeC--CCCcEEEE-ecCCccEEEee--------cCceEEEEecCC
Confidence 6899999999997763 4477999999988766653 22222222 22222333333 222222211 12
Q ss_pred CcE-EEEEee--C------CceeEEEEeCCeEEEEECCEEEEEEcCC-----cEEEEEEeccC-----CCCc--eEEEee
Q 020784 166 SRC-IGELSF--R------SEVRSVKLRRDRIIVVLEQKIFVYNFAD-----LKLLHQIETIA-----NPKG--LCAVSQ 224 (321)
Q Consensus 166 ~~~-~~~~~~--~------~~v~~v~~~~~~~~~~~~~~I~iwd~~~-----~~~~~~l~~~~-----~~~~--~~~~s~ 224 (321)
|+. ...... . ....-.......+++...++|.+.|+.. .+.+..+.... .+.+ .+++++
T Consensus 178 g~~~~~~~~vf~~~~~~v~~rP~~~~~dg~~~~vs~eG~V~~id~~~~~~~~~~~~~~~~~~~~~~~wrP~g~q~ia~~~ 257 (352)
T TIGR02658 178 GNPKIKPTEVFHPEDEYLINHPAYSNKSGRLVWPTYTGKIFQIDLSSGDAKFLPAIEAFTEAEKADGWRPGGWQQVAYHR 257 (352)
T ss_pred CceEEeeeeeecCCccccccCCceEcCCCcEEEEecCCeEEEEecCCCcceecceeeeccccccccccCCCcceeEEEcC
Confidence 221 111111 1 1110011133456677779999999633 33333332111 1222 356665
Q ss_pred CCCceEEEeecCC-------CCcEEEEeeCCcceE-EeeccccceeEEEECCCCC-EEEEEe-CCCcEEEEEEcCCCcEE
Q 020784 225 GVGSLVLVCPGLQ-------KGQVRVEHYASKRTK-FIMAHDSRIACFALTQDGQ-LLATSS-TKGTLVRIFNTLDGTLL 294 (321)
Q Consensus 225 ~~d~~~la~sGs~-------dg~V~i~d~~~~~~~-~l~~H~~~V~~vafspdg~-~las~S-~Dgt~IrIWd~~tg~~i 294 (321)
++...+++..+.. .+.|.++|..+.... .+. -...+..|+|+|||+ +|.+.. .++. |.|+|+.+++.+
T Consensus 258 dg~~lyV~~~~~~~~thk~~~~~V~ViD~~t~kvi~~i~-vG~~~~~iavS~Dgkp~lyvtn~~s~~-VsViD~~t~k~i 335 (352)
T TIGR02658 258 ARDRIYLLADQRAKWTHKTASRFLFVVDAKTGKRLRKIE-LGHEIDSINVSQDAKPLLYALSTGDKT-LYIFDAETGKEL 335 (352)
T ss_pred CCCEEEEEecCCccccccCCCCEEEEEECCCCeEEEEEe-CCCceeeEEECCCCCeEEEEeCCCCCc-EEEEECcCCeEE
Confidence 5443343222211 247888888776644 333 245799999999999 777666 5777 999999999999
Q ss_pred EEE-eCCC
Q 020784 295 QEE-CCPS 301 (321)
Q Consensus 295 ~~~-~~g~ 301 (321)
+++ ..|.
T Consensus 336 ~~i~~vg~ 343 (352)
T TIGR02658 336 SSVNQLGR 343 (352)
T ss_pred eeeccCCC
Confidence 998 4443
No 260
>KOG0322 consensus G-protein beta subunit-like protein GNB1L, contains WD repeats [General function prediction only]
Probab=98.61 E-value=4.7e-07 Score=77.18 Aligned_cols=154 Identities=14% Similarity=0.203 Sum_probs=98.3
Q ss_pred CCCCCeEEEEEcC-CC-CE-EEEEcCCc-EEEEEecCCceeEEee---------eecCCceEEEEEecCCCeEEEEeCCC
Q 020784 83 SPPPTLLHISFNQ-DH-GC-FAAGTDHG-FRIYNCDPFREIFRRD---------FERGGGIGVVEMLFRCNILALVGGGP 149 (321)
Q Consensus 83 ~~~~~V~~v~fs~-dg-~~-lasg~~~g-v~vw~~~~~~~~~~~~---------~~~~~~v~~v~~~~~~~~~~~~sg~~ 149 (321)
...+.|.|..+.- ++ +. |++|-+.| |.+||+.+...+.... ..|.+++..+++....+.-+..+
T Consensus 148 ~Klgsvmc~~~~~~c~s~~lllaGyEsghvv~wd~S~~~~~~~~~~~~kv~~~~ash~qpvlsldyas~~~rGisgg--- 224 (323)
T KOG0322|consen 148 SKLGSVMCQDKDHACGSTFLLLAGYESGHVVIWDLSTGDKIIQLPQSSKVESPNASHKQPVLSLDYASSCDRGISGG--- 224 (323)
T ss_pred cccCceeeeeccccccceEEEEEeccCCeEEEEEccCCceeeccccccccccchhhccCcceeeeechhhcCCcCCC---
Confidence 4445787777443 33 33 44666666 7799998763222111 11567777777654333222222
Q ss_pred CCCCCCCcEEEEeCCC--CcE--EEEEeeCC-ceeEEEEeCCeEEEEE---CCEEEEEEcCCcEEEEEEeccCCCCceEE
Q 020784 150 DPQYPLNKVMIWDDHQ--SRC--IGELSFRS-EVRSVKLRRDRIIVVL---EQKIFVYNFADLKLLHQIETIANPKGLCA 221 (321)
Q Consensus 150 ~~~~~d~~v~iWD~~~--~~~--~~~~~~~~-~v~~v~~~~~~~~~~~---~~~I~iwd~~~~~~~~~l~~~~~~~~~~~ 221 (321)
.+..+..|.++. +.+ ..++.... .|..+.+-++..+.++ |+.||+|+.++++.+..++.|...+..++
T Consensus 225 ----a~dkl~~~Sl~~s~gslq~~~e~~lknpGv~gvrIRpD~KIlATAGWD~RiRVyswrtl~pLAVLkyHsagvn~vA 300 (323)
T KOG0322|consen 225 ----ADDKLVMYSLNHSTGSLQIRKEITLKNPGVSGVRIRPDGKILATAGWDHRIRVYSWRTLNPLAVLKYHSAGVNAVA 300 (323)
T ss_pred ----ccccceeeeeccccCcccccceEEecCCCccceEEccCCcEEeecccCCcEEEEEeccCCchhhhhhhhcceeEEE
Confidence 457788888753 332 22333322 4666777776655554 67999999999999999999986655555
Q ss_pred EeeCCCceEEEeecCCCCcEEEEee
Q 020784 222 VSQGVGSLVLVCPGLQKGQVRVEHY 246 (321)
Q Consensus 222 ~s~~~d~~~la~sGs~dg~V~i~d~ 246 (321)
|++ +..++| +++.|+.|-+|++
T Consensus 301 fsp--d~~lmA-aaskD~rISLWkL 322 (323)
T KOG0322|consen 301 FSP--DCELMA-AASKDARISLWKL 322 (323)
T ss_pred eCC--CCchhh-hccCCceEEeeec
Confidence 554 568888 4999999999985
No 261
>COG4946 Uncharacterized protein related to the periplasmic component of the Tol biopolymer transport system [Function unknown]
Probab=98.59 E-value=3.6e-05 Score=70.85 Aligned_cols=125 Identities=13% Similarity=0.028 Sum_probs=91.9
Q ss_pred CCCCcccCCCCCCeEEEEEcCCCCEEEEEcCCc--EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCC
Q 020784 75 SPAESTSSSPPPTLLHISFNQDHGCFAAGTDHG--FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQ 152 (321)
Q Consensus 75 ~~~~~~~~~~~~~V~~v~fs~dg~~lasg~~~g--v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~ 152 (321)
...+++...++..|+...+.-++.-++.|..+| +-|||.++++...... .-+.|..+..++++..++++.
T Consensus 349 ~~~~~iqv~~~~~VrY~r~~~~~e~~vigt~dgD~l~iyd~~~~e~kr~e~--~lg~I~av~vs~dGK~~vvaN------ 420 (668)
T COG4946 349 WDGYSIQVGKKGGVRYRRIQVDPEGDVIGTNDGDKLGIYDKDGGEVKRIEK--DLGNIEAVKVSPDGKKVVVAN------ 420 (668)
T ss_pred CCCeeEEcCCCCceEEEEEccCCcceEEeccCCceEEEEecCCceEEEeeC--CccceEEEEEcCCCcEEEEEc------
Confidence 344566677888999999999999999998866 6799999887543322 247788889999998887776
Q ss_pred CCCCcEEEEeCCCCcEEEEEe-eCCceeEEEEeCCeEEEEE-------CCEEEEEEcCCcEEEE
Q 020784 153 YPLNKVMIWDDHQSRCIGELS-FRSEVRSVKLRRDRIIVVL-------EQKIFVYNFADLKLLH 208 (321)
Q Consensus 153 ~~d~~v~iWD~~~~~~~~~~~-~~~~v~~v~~~~~~~~~~~-------~~~I~iwd~~~~~~~~ 208 (321)
+...+-+.|++++.....-+ ...-|+.+.||++.-.++- ...|++||+.+++...
T Consensus 421 -dr~el~vididngnv~~idkS~~~lItdf~~~~nsr~iAYafP~gy~tq~Iklydm~~~Kiy~ 483 (668)
T COG4946 421 -DRFELWVIDIDNGNVRLIDKSEYGLITDFDWHPNSRWIAYAFPEGYYTQSIKLYDMDGGKIYD 483 (668)
T ss_pred -CceEEEEEEecCCCeeEecccccceeEEEEEcCCceeEEEecCcceeeeeEEEEecCCCeEEE
Confidence 44678888999887543222 2235888999987655542 2589999998877654
No 262
>KOG3881 consensus Uncharacterized conserved protein [Function unknown]
Probab=98.58 E-value=4.3e-06 Score=74.90 Aligned_cols=223 Identities=14% Similarity=0.140 Sum_probs=131.3
Q ss_pred CCeEEEEEcCCCC--EEEEE-cCCcEEEEEecCCceeEEe----eeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcE
Q 020784 86 PTLLHISFNQDHG--CFAAG-TDHGFRIYNCDPFREIFRR----DFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 86 ~~V~~v~fs~dg~--~lasg-~~~gv~vw~~~~~~~~~~~----~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
.+|..++|.-|++ .|... .++.+..+......+.... .. +.+.-.+.........+.++. .+|.+
T Consensus 56 ~ris~l~~~~d~~tevl~~r~~~~~~~~~~~~E~~~~s~~~~~~~~-~l~~~~I~gl~~~dg~Litc~-------~sG~l 127 (412)
T KOG3881|consen 56 DRISSLLFGVDGETEVLNARSADDDLPKFVIEEFEISSSLDDAKTV-SLGTKSIKGLKLADGTLITCV-------SSGNL 127 (412)
T ss_pred hhhhhheeecCCceeEeeccccCcccccccccCCcccccccccccc-ccccccccchhhcCCEEEEEe-------cCCcE
Confidence 4788888887765 33333 3444555555444332221 00 111112222222233444444 35899
Q ss_pred EEEeCCCCcE----EEEEeeCCceeEEEEeCC--eEEE-EE-C--CEEEEEEcCCcEEEEEEeccCC-------CCceE-
Q 020784 159 MIWDDHQSRC----IGELSFRSEVRSVKLRRD--RIIV-VL-E--QKIFVYNFADLKLLHQIETIAN-------PKGLC- 220 (321)
Q Consensus 159 ~iWD~~~~~~----~~~~~~~~~v~~v~~~~~--~~~~-~~-~--~~I~iwd~~~~~~~~~l~~~~~-------~~~~~- 220 (321)
.+|..+.+.. ...+.....+..+.-++. .+++ ++ . +.++|||+.+.+.+.+=+.-.+ ++-..
T Consensus 128 ~~~~~k~~d~hss~l~~la~g~g~~~~r~~~~~p~Iva~GGke~~n~lkiwdle~~~qiw~aKNvpnD~L~LrVPvW~td 207 (412)
T KOG3881|consen 128 QVRHDKSGDLHSSKLIKLATGPGLYDVRQTDTDPYIVATGGKENINELKIWDLEQSKQIWSAKNVPNDRLGLRVPVWITD 207 (412)
T ss_pred EEEeccCCccccccceeeecCCceeeeccCCCCCceEecCchhcccceeeeecccceeeeeccCCCCccccceeeeeecc
Confidence 9999885542 223344444444444332 2222 22 2 4799999987754333222111 11122
Q ss_pred -EEeeCCCceEEEeecCCCCcEEEEeeCC--cceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEE
Q 020784 221 -AVSQGVGSLVLVCPGLQKGQVRVEHYAS--KRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEE 297 (321)
Q Consensus 221 -~~s~~~d~~~la~sGs~dg~V~i~d~~~--~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~ 297 (321)
.|-+..++..+| +++.-+.|++||.+. +++..|.--..+|+++...|+|.++.+|-.-|. +..||+++++++...
T Consensus 208 i~Fl~g~~~~~fa-t~T~~hqvR~YDt~~qRRPV~~fd~~E~~is~~~l~p~gn~Iy~gn~~g~-l~~FD~r~~kl~g~~ 285 (412)
T KOG3881|consen 208 IRFLEGSPNYKFA-TITRYHQVRLYDTRHQRRPVAQFDFLENPISSTGLTPSGNFIYTGNTKGQ-LAKFDLRGGKLLGCG 285 (412)
T ss_pred ceecCCCCCceEE-EEecceeEEEecCcccCcceeEeccccCcceeeeecCCCcEEEEecccch-hheecccCceeeccc
Confidence 333332256666 478889999999875 346677778899999999999999999998888 999999999998774
Q ss_pred eCCCcceeE--EEeecCceEEEe
Q 020784 298 CCPSISAQS--GLWLSSAWLRVL 318 (321)
Q Consensus 298 ~~g~~~~~~--~~s~d~~~la~~ 318 (321)
..|-...+. ..-+..++||.+
T Consensus 286 ~kg~tGsirsih~hp~~~~las~ 308 (412)
T KOG3881|consen 286 LKGITGSIRSIHCHPTHPVLASC 308 (412)
T ss_pred cCCccCCcceEEEcCCCceEEee
Confidence 455554444 334555688764
No 263
>PRK04043 tolB translocation protein TolB; Provisional
Probab=98.57 E-value=3.8e-05 Score=72.60 Aligned_cols=192 Identities=12% Similarity=0.044 Sum_probs=115.7
Q ss_pred CeEEEEEcCCCCE-EEEEcCC----cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 87 TLLHISFNQDHGC-FAAGTDH----GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 87 ~V~~v~fs~dg~~-lasg~~~----gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
.+..-.|+|||+. ++..+.. .+.++|+.+++....... .+......|+++++.+++..... .+..|.++
T Consensus 189 ~~~~p~wSpDG~~~i~y~s~~~~~~~Iyv~dl~tg~~~~lt~~--~g~~~~~~~SPDG~~la~~~~~~----g~~~Iy~~ 262 (419)
T PRK04043 189 LNIFPKWANKEQTAFYYTSYGERKPTLYKYNLYTGKKEKIASS--QGMLVVSDVSKDGSKLLLTMAPK----GQPDIYLY 262 (419)
T ss_pred CeEeEEECCCCCcEEEEEEccCCCCEEEEEECCCCcEEEEecC--CCcEEeeEECCCCCEEEEEEccC----CCcEEEEE
Confidence 6778999999985 6543332 266778877765433332 45555678999998887765432 24678888
Q ss_pred eCCCCcEEEEEeeCCceeEEEEeCC--eEEEEECC----EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeec
Q 020784 162 DDHQSRCIGELSFRSEVRSVKLRRD--RIIVVLEQ----KIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPG 235 (321)
Q Consensus 162 D~~~~~~~~~~~~~~~v~~v~~~~~--~~~~~~~~----~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sG 235 (321)
|+..+................|+++ .++..++. .|.++|+.+++..+..... .. ...+++ |+..++++.
T Consensus 263 dl~~g~~~~LT~~~~~d~~p~~SPDG~~I~F~Sdr~g~~~Iy~~dl~~g~~~rlt~~g-~~--~~~~SP--DG~~Ia~~~ 337 (419)
T PRK04043 263 DTNTKTLTQITNYPGIDVNGNFVEDDKRIVFVSDRLGYPNIFMKKLNSGSVEQVVFHG-KN--NSSVST--YKNYIVYSS 337 (419)
T ss_pred ECCCCcEEEcccCCCccCccEECCCCCEEEEEECCCCCceEEEEECCCCCeEeCccCC-Cc--CceECC--CCCEEEEEE
Confidence 9888765433233332334568775 45555542 7888899877653332221 11 224555 556666655
Q ss_pred CCC------C--cEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCc--EEEEEEcCC
Q 020784 236 LQK------G--QVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGT--LVRIFNTLD 290 (321)
Q Consensus 236 s~d------g--~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt--~IrIWd~~t 290 (321)
... + .|.+.+..++....+.... ......|+|||+.++-.+.++. .+.+.++..
T Consensus 338 ~~~~~~~~~~~~~I~v~d~~~g~~~~LT~~~-~~~~p~~SPDG~~I~f~~~~~~~~~L~~~~l~g 401 (419)
T PRK04043 338 RETNNEFGKNTFNLYLISTNSDYIRRLTANG-VNQFPRFSSDGGSIMFIKYLGNQSALGIIRLNY 401 (419)
T ss_pred cCCCcccCCCCcEEEEEECCCCCeEECCCCC-CcCCeEECCCCCEEEEEEccCCcEEEEEEecCC
Confidence 433 2 5666777777666665542 3346889999998776655432 244455543
No 264
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=98.57 E-value=9e-05 Score=64.06 Aligned_cols=185 Identities=16% Similarity=0.147 Sum_probs=116.2
Q ss_pred CCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEE-e
Q 020784 95 QDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGEL-S 173 (321)
Q Consensus 95 ~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~-~ 173 (321)
.++..++...++.+..||..+++.+....+ .+.+.... ...++.+++.. .++.|..+|..+|+.+... .
T Consensus 35 ~~~~v~~~~~~~~l~~~d~~tG~~~W~~~~--~~~~~~~~-~~~~~~v~v~~-------~~~~l~~~d~~tG~~~W~~~~ 104 (238)
T PF13360_consen 35 DGGRVYVASGDGNLYALDAKTGKVLWRFDL--PGPISGAP-VVDGGRVYVGT-------SDGSLYALDAKTGKVLWSIYL 104 (238)
T ss_dssp ETTEEEEEETTSEEEEEETTTSEEEEEEEC--SSCGGSGE-EEETTEEEEEE-------TTSEEEEEETTTSCEEEEEEE
T ss_pred eCCEEEEEcCCCEEEEEECCCCCEEEEeec--ccccccee-eeccccccccc-------ceeeeEecccCCcceeeeecc
Confidence 444444444557788999999998877775 23222212 23345555555 3578999999999988774 3
Q ss_pred eCC------ceeEEEEeCCeEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCc---------eEEEeeCCCceEEEeecCC
Q 020784 174 FRS------EVRSVKLRRDRIIVVL-EQKIFVYNFADLKLLHQIETIANPKG---------LCAVSQGVGSLVLVCPGLQ 237 (321)
Q Consensus 174 ~~~------~v~~v~~~~~~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~---------~~~~s~~~d~~~la~sGs~ 237 (321)
... ......+..+.++++. ++.|..+|..+|+.+........... ....... ++.+++ ++.
T Consensus 105 ~~~~~~~~~~~~~~~~~~~~~~~~~~~g~l~~~d~~tG~~~w~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~v~~--~~~ 181 (238)
T PF13360_consen 105 TSSPPAGVRSSSSPAVDGDRLYVGTSSGKLVALDPKTGKLLWKYPVGEPRGSSPISSFSDINGSPVIS-DGRVYV--SSG 181 (238)
T ss_dssp -SSCTCSTB--SEEEEETTEEEEEETCSEEEEEETTTTEEEEEEESSTT-SS--EEEETTEEEEEECC-TTEEEE--ECC
T ss_pred ccccccccccccCceEecCEEEEEeccCcEEEEecCCCcEEEEeecCCCCCCcceeeecccccceEEE-CCEEEE--EcC
Confidence 221 2334556677888887 68999999999999988877432211 1222222 235555 355
Q ss_pred CCc-EEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEE
Q 020784 238 KGQ-VRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQE 296 (321)
Q Consensus 238 dg~-V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~ 296 (321)
+|. +.+ |..++.... ......+..+ ...++..|+.++.|+. |..||+++|+.+-+
T Consensus 182 ~g~~~~~-d~~tg~~~w-~~~~~~~~~~-~~~~~~~l~~~~~~~~-l~~~d~~tG~~~W~ 237 (238)
T PF13360_consen 182 DGRVVAV-DLATGEKLW-SKPISGIYSL-PSVDGGTLYVTSSDGR-LYALDLKTGKVVWQ 237 (238)
T ss_dssp TSSEEEE-ETTTTEEEE-EECSS-ECEC-EECCCTEEEEEETTTE-EEEEETTTTEEEEE
T ss_pred CCeEEEE-ECCCCCEEE-EecCCCccCC-ceeeCCEEEEEeCCCE-EEEEECCCCCEEeE
Confidence 564 555 887776442 2223333332 3466777777778999 99999999998643
No 265
>KOG2315 consensus Predicted translation initiation factor related to eIF-3a [Translation, ribosomal structure and biogenesis]
Probab=98.57 E-value=2.1e-05 Score=73.56 Aligned_cols=204 Identities=16% Similarity=0.202 Sum_probs=127.3
Q ss_pred CCCCCCeEEEEEcCCCC--EEEE-----EcC-CcEEEEEecCCc---eeEEeeeecCCceEEEEEecCCCeE-EEEeCCC
Q 020784 82 SSPPPTLLHISFNQDHG--CFAA-----GTD-HGFRIYNCDPFR---EIFRRDFERGGGIGVVEMLFRCNIL-ALVGGGP 149 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~--~las-----g~~-~gv~vw~~~~~~---~~~~~~~~~~~~v~~v~~~~~~~~~-~~~sg~~ 149 (321)
..|...|+...+||.+. ++|+ ++. .-||||.+.-.+ .+-.+.| -...-..+.|...+..+ ++++..-
T Consensus 162 kl~~~~i~~f~lSpgp~~~~vAvyvPe~kGaPa~vri~~~~~~~~~~~~a~ksF-Fkadkvqm~WN~~gt~LLvLastdV 240 (566)
T KOG2315|consen 162 KLSVSGITMLSLSPGPEPPFVAVYVPEKKGAPASVRIYKYPEEGQHQPVANKSF-FKADKVQMKWNKLGTALLVLASTDV 240 (566)
T ss_pred eeeccceeeEEecCCCCCceEEEEccCCCCCCcEEEEeccccccccchhhhccc-cccceeEEEeccCCceEEEEEEEee
Confidence 45667899999999743 4543 222 348899875211 1112222 01222233444444433 3333221
Q ss_pred CC---C-CCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCe--EEEEEC---CEEEEEEcCCcEEEEEEeccCCCCceE
Q 020784 150 DP---Q-YPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDR--IIVVLE---QKIFVYNFADLKLLHQIETIANPKGLC 220 (321)
Q Consensus 150 ~~---~-~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~--~~~~~~---~~I~iwd~~~~~~~~~l~~~~~~~~~~ 220 (321)
|- . |-..++.+.+.+...++..+.-.++|.++.|+++. ++++-+ -++.|||++ ++.+.. ...++...+
T Consensus 241 Dktn~SYYGEq~Lyll~t~g~s~~V~L~k~GPVhdv~W~~s~~EF~VvyGfMPAkvtifnlr-~~~v~d--f~egpRN~~ 317 (566)
T KOG2315|consen 241 DKTNASYYGEQTLYLLATQGESVSVPLLKEGPVHDVTWSPSGREFAVVYGFMPAKVTIFNLR-GKPVFD--FPEGPRNTA 317 (566)
T ss_pred cCCCccccccceEEEEEecCceEEEecCCCCCceEEEECCCCCEEEEEEecccceEEEEcCC-CCEeEe--CCCCCccce
Confidence 10 0 12356888888755566666667899999999865 777765 499999987 444444 445567778
Q ss_pred EEeeCCCceEEEeecC--CCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeC------CCcEEEEEEcCCC
Q 020784 221 AVSQGVGSLVLVCPGL--QKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSST------KGTLVRIFNTLDG 291 (321)
Q Consensus 221 ~~s~~~d~~~la~sGs--~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~------Dgt~IrIWd~~tg 291 (321)
-|++++ .++++.|. -.|.+.|||..+.. +..+.+-. -+-+.|+|||++|+|+.. |+. ++||+.. |
T Consensus 318 ~fnp~g--~ii~lAGFGNL~G~mEvwDv~n~K~i~~~~a~~--tt~~eW~PdGe~flTATTaPRlrvdNg-~Kiwhyt-G 391 (566)
T KOG2315|consen 318 FFNPHG--NIILLAGFGNLPGDMEVWDVPNRKLIAKFKAAN--TTVFEWSPDGEYFLTATTAPRLRVDNG-IKIWHYT-G 391 (566)
T ss_pred EECCCC--CEEEEeecCCCCCceEEEeccchhhccccccCC--ceEEEEcCCCcEEEEEeccccEEecCC-eEEEEec-C
Confidence 888876 55555454 46899999987744 33554433 456789999999988754 788 9999975 5
Q ss_pred cEEE
Q 020784 292 TLLQ 295 (321)
Q Consensus 292 ~~i~ 295 (321)
.+++
T Consensus 392 ~~l~ 395 (566)
T KOG2315|consen 392 SLLH 395 (566)
T ss_pred ceee
Confidence 5544
No 266
>COG5170 CDC55 Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=98.55 E-value=1.3e-06 Score=76.25 Aligned_cols=203 Identities=14% Similarity=0.252 Sum_probs=115.6
Q ss_pred CCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCc-eeEE--eeee-c------------CCceEEEEEecCC--CeEEE
Q 020784 84 PPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFR-EIFR--RDFE-R------------GGGIGVVEMLFRC--NILAL 144 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~-~~~~--~~~~-~------------~~~v~~v~~~~~~--~~~~~ 144 (321)
....|++|.|...|.|||+|..+| |.+|.-.... +.+. -+|+ | ...|..++|.-++ +.+.+
T Consensus 25 ead~ItaVefd~tg~YlatGDkgGRVvlfer~~s~~ceykf~teFQshe~EFDYLkSleieEKin~I~w~~~t~r~hFLl 104 (460)
T COG5170 25 EADKITAVEFDETGLYLATGDKGGRVVLFEREKSYGCEYKFFTEFQSHELEFDYLKSLEIEEKINAIEWFDDTGRNHFLL 104 (460)
T ss_pred ccceeeEEEeccccceEeecCCCceEEEeecccccccchhhhhhhcccccchhhhhhccHHHHhhheeeecCCCcceEEE
Confidence 345899999999999999998877 6677643322 1110 1111 1 2245566665443 34555
Q ss_pred EeCCCCCCCCCCcEEEEeCCCCc--EEE-------------------------EEeeC-----------------CceeE
Q 020784 145 VGGGPDPQYPLNKVMIWDDHQSR--CIG-------------------------ELSFR-----------------SEVRS 180 (321)
Q Consensus 145 ~sg~~~~~~~d~~v~iWD~~~~~--~~~-------------------------~~~~~-----------------~~v~~ 180 (321)
++ +|++|++|.+.... .+. .+..+ -.+.+
T Consensus 105 st-------NdktiKlWKiyeknlk~va~nnls~~~~~~~~g~~~s~~~l~lprls~hd~iiaa~p~rvyaNaH~yhiNS 177 (460)
T COG5170 105 ST-------NDKTIKLWKIYEKNLKVVAENNLSDSFHSPMGGPLTSTKELLLPRLSEHDEIIAAKPCRVYANAHPYHINS 177 (460)
T ss_pred ec-------CCceeeeeeeecccchhhhccccccccccccCCCcCCHHHhhcccccccceEEEeccceeccccceeEeee
Confidence 55 68999999865431 000 01111 12445
Q ss_pred EEEeCCeE-EEEECC-EEEEEEcCCcE-EE--EEEeccCC-----CCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc
Q 020784 181 VKLRRDRI-IVVLEQ-KIFVYNFADLK-LL--HQIETIAN-----PKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR 250 (321)
Q Consensus 181 v~~~~~~~-~~~~~~-~I~iwd~~~~~-~~--~~l~~~~~-----~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~ 250 (321)
+.++.+.- ++..+. .|.+|++.... .. ..++.|.- .+...-|++. .++.+.+ .+..|.|++-|++...
T Consensus 178 iS~NsD~et~lSaDdLrINLWnl~i~D~sFnIVDiKP~nmeeLteVItSaeFhp~-~cn~fmY-SsSkG~Ikl~DlRq~a 255 (460)
T COG5170 178 ISFNSDKETLLSADDLRINLWNLEIIDGSFNIVDIKPHNMEELTEVITSAEFHPE-MCNVFMY-SSSKGEIKLNDLRQSA 255 (460)
T ss_pred eeecCchheeeeccceeeeeccccccCCceEEEeccCccHHHHHHHHhhcccCHh-HcceEEE-ecCCCcEEehhhhhhh
Confidence 55655442 333333 89999985321 11 12222211 1223445543 2345555 5678999998876321
Q ss_pred e-----E------------EeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCC-cEEEEE
Q 020784 251 T-----K------------FIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDG-TLLQEE 297 (321)
Q Consensus 251 ~-----~------------~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg-~~i~~~ 297 (321)
+ + -+.+..+.|..+.|+++|+++++-+.- + |+|||++.. .++.+.
T Consensus 256 lcdn~~klfe~~~D~v~~~ff~eivsSISD~kFs~ngryIlsRdyl-t-vkiwDvnm~k~pikTi 318 (460)
T COG5170 256 LCDNSKKLFELTIDGVDVDFFEEIVSSISDFKFSDNGRYILSRDYL-T-VKIWDVNMAKNPIKTI 318 (460)
T ss_pred hccCchhhhhhccCcccchhHHHHhhhhcceEEcCCCcEEEEeccc-e-EEEEecccccCCceee
Confidence 1 1 123345678889999999999877543 5 999999864 345543
No 267
>KOG4227 consensus WD40 repeat protein [General function prediction only]
Probab=98.54 E-value=3.9e-06 Score=75.25 Aligned_cols=156 Identities=13% Similarity=0.131 Sum_probs=107.0
Q ss_pred cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCC------CcEEEEEe--eCCceeEEEEeCC-e-EEEEE-CC
Q 020784 126 RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQ------SRCIGELS--FRSEVRSVKLRRD-R-IIVVL-EQ 194 (321)
Q Consensus 126 ~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~------~~~~~~~~--~~~~v~~v~~~~~-~-~~~~~-~~ 194 (321)
|.+.|..++++.++..++ +|| +|..+++|+++. .+.+.... +.+.|.+++|+-. . ++.+. .+
T Consensus 55 H~GCiNAlqFS~N~~~L~--SGG-----DD~~~~~W~~de~~~~k~~KPI~~~~~~H~SNIF~L~F~~~N~~~~SG~~~~ 127 (609)
T KOG4227|consen 55 HTGCINALQFSHNDRFLA--SGG-----DDMHGRVWNVDELMVRKTPKPIGVMEHPHRSNIFSLEFDLENRFLYSGERWG 127 (609)
T ss_pred hccccceeeeccCCeEEe--ecC-----CcceeeeechHHHHhhcCCCCceeccCccccceEEEEEccCCeeEecCCCcc
Confidence 577888888877765554 444 579999999753 23333332 3368999999753 3 33332 36
Q ss_pred EEEEEEcCCcEEEEEEeccCCC--CceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc----eEEeeccccceeEEEECC
Q 020784 195 KIFVYNFADLKLLHQIETIANP--KGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR----TKFIMAHDSRIACFALTQ 268 (321)
Q Consensus 195 ~I~iwd~~~~~~~~~l~~~~~~--~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~----~~~l~~H~~~V~~vafsp 268 (321)
+|..-|+.+.+.+..+....+. +.-+..+|. .++++ +.+.+|.|.+||....+ +.-+........++-|+|
T Consensus 128 ~VI~HDiEt~qsi~V~~~~~~~~~VY~m~~~P~--DN~~~-~~t~~~~V~~~D~Rd~~~~~~~~~~AN~~~~F~t~~F~P 204 (609)
T KOG4227|consen 128 TVIKHDIETKQSIYVANENNNRGDVYHMDQHPT--DNTLI-VVTRAKLVSFIDNRDRQNPISLVLPANSGKNFYTAEFHP 204 (609)
T ss_pred eeEeeecccceeeeeecccCcccceeecccCCC--CceEE-EEecCceEEEEeccCCCCCCceeeecCCCccceeeeecC
Confidence 9999999998888777654433 333444554 35555 36889999999987654 222333456678999998
Q ss_pred CC-CEEEEEeCCCcEEEEEEcCCCc
Q 020784 269 DG-QLLATSSTKGTLVRIFNTLDGT 292 (321)
Q Consensus 269 dg-~~las~S~Dgt~IrIWd~~tg~ 292 (321)
.. .+|++.+..+. +.|||.+..+
T Consensus 205 ~~P~Li~~~~~~~G-~~~~D~R~~~ 228 (609)
T KOG4227|consen 205 ETPALILVNSETGG-PNVFDRRMQA 228 (609)
T ss_pred CCceeEEeccccCC-CCceeecccc
Confidence 74 68899999999 9999998643
No 268
>PRK04043 tolB translocation protein TolB; Provisional
Probab=98.53 E-value=0.0002 Score=67.64 Aligned_cols=182 Identities=9% Similarity=0.065 Sum_probs=111.4
Q ss_pred CceEEEEEecCCCe-EEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCC--eEEEEEC----CEEEEEE
Q 020784 128 GGIGVVEMLFRCNI-LALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRD--RIIVVLE----QKIFVYN 200 (321)
Q Consensus 128 ~~v~~v~~~~~~~~-~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~--~~~~~~~----~~I~iwd 200 (321)
+....-.|+++++. ++..+-.. ....|.++|+.+++........+......|+++ +++...+ ..|.++|
T Consensus 188 ~~~~~p~wSpDG~~~i~y~s~~~----~~~~Iyv~dl~tg~~~~lt~~~g~~~~~~~SPDG~~la~~~~~~g~~~Iy~~d 263 (419)
T PRK04043 188 GLNIFPKWANKEQTAFYYTSYGE----RKPTLYKYNLYTGKKEKIASSQGMLVVSDVSKDGSKLLLTMAPKGQPDIYLYD 263 (419)
T ss_pred CCeEeEEECCCCCcEEEEEEccC----CCCEEEEEECCCCcEEEEecCCCcEEeeEECCCCCEEEEEEccCCCcEEEEEE
Confidence 34455688889885 55544221 135799999988876554455555666778876 3544432 4888999
Q ss_pred cCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCC--cEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeC
Q 020784 201 FADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKG--QVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSST 278 (321)
Q Consensus 201 ~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg--~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~ 278 (321)
+.+++. +.+..+........+++ |+..|+++....| .|.+.++.++....+...... ...|||||++||-.+.
T Consensus 264 l~~g~~-~~LT~~~~~d~~p~~SP--DG~~I~F~Sdr~g~~~Iy~~dl~~g~~~rlt~~g~~--~~~~SPDG~~Ia~~~~ 338 (419)
T PRK04043 264 TNTKTL-TQITNYPGIDVNGNFVE--DDKRIVFVSDRLGYPNIFMKKLNSGSVEQVVFHGKN--NSSVSTYKNYIVYSSR 338 (419)
T ss_pred CCCCcE-EEcccCCCccCccEECC--CCCEEEEEECCCCCceEEEEECCCCCeEeCccCCCc--CceECCCCCEEEEEEc
Confidence 877764 34443322222334555 4555555444445 455577766655433322212 2489999998887765
Q ss_pred CC--------cEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEee
Q 020784 279 KG--------TLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 279 Dg--------t~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~~ 319 (321)
.. ..|.+.|+.+|.. +.+..+.....-.+++||++|+.++
T Consensus 339 ~~~~~~~~~~~~I~v~d~~~g~~-~~LT~~~~~~~p~~SPDG~~I~f~~ 386 (419)
T PRK04043 339 ETNNEFGKNTFNLYLISTNSDYI-RRLTANGVNQFPRFSSDGGSIMFIK 386 (419)
T ss_pred CCCcccCCCCcEEEEEECCCCCe-EECCCCCCcCCeEECCCCCEEEEEE
Confidence 42 2378889888875 4454443333458899999998875
No 269
>KOG1310 consensus WD40 repeat protein [General function prediction only]
Probab=98.50 E-value=5.7e-07 Score=83.64 Aligned_cols=153 Identities=13% Similarity=0.207 Sum_probs=103.4
Q ss_pred cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEee--CCceeEEEEeC---CeEEEE--ECCEEEE
Q 020784 126 RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSF--RSEVRSVKLRR---DRIIVV--LEQKIFV 198 (321)
Q Consensus 126 ~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~--~~~v~~v~~~~---~~~~~~--~~~~I~i 198 (321)
|.|.|.+++|..++.+++..+ +|-.+.|||.-..+.+..+.. ...|.++.|-| +++++. .|..|++
T Consensus 49 H~GCVN~LeWn~dG~lL~SGS-------DD~r~ivWd~~~~KllhsI~TgHtaNIFsvKFvP~tnnriv~sgAgDk~i~l 121 (758)
T KOG1310|consen 49 HTGCVNCLEWNADGELLASGS-------DDTRLIVWDPFEYKLLHSISTGHTANIFSVKFVPYTNNRIVLSGAGDKLIKL 121 (758)
T ss_pred ccceecceeecCCCCEEeecC-------CcceEEeecchhcceeeeeecccccceeEEeeeccCCCeEEEeccCcceEEE
Confidence 788999999999998887666 678999999887777766643 34799999975 445444 4569999
Q ss_pred EEcCCc----------EEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc--eE---------Eeecc
Q 020784 199 YNFADL----------KLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR--TK---------FIMAH 257 (321)
Q Consensus 199 wd~~~~----------~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~--~~---------~l~~H 257 (321)
||+... +..+.+..|...+.-++..+++.+.+. +++.||+++-+|+...- .. .+...
T Consensus 122 fdl~~~~~~~~d~~~~~~~~~~~cht~rVKria~~p~~Phtfw--sasEDGtirQyDiREph~c~p~~~~~~~l~ny~~~ 199 (758)
T KOG1310|consen 122 FDLDSSKEGGMDHGMEETTRCWSCHTDRVKRIATAPNGPHTFW--SASEDGTIRQYDIREPHVCNPDEDCPSILVNYNPQ 199 (758)
T ss_pred EecccccccccccCccchhhhhhhhhhhhhheecCCCCCceEE--EecCCcceeeecccCCccCCccccccHHHHHhchh
Confidence 999741 111222223333334444444433333 57999999999987521 11 11222
Q ss_pred ccceeEEEECCC-CCEEEEEeCCCcEEEEEEc
Q 020784 258 DSRIACFALTQD-GQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 258 ~~~V~~vafspd-g~~las~S~Dgt~IrIWd~ 288 (321)
--...|+.++|. ..+||.|+.|-- .|++|.
T Consensus 200 lielk~ltisp~rp~~laVGgsdpf-arLYD~ 230 (758)
T KOG1310|consen 200 LIELKCLTISPSRPYYLAVGGSDPF-ARLYDR 230 (758)
T ss_pred hheeeeeeecCCCCceEEecCCCch-hhhhhh
Confidence 234678999986 568999998888 999994
No 270
>COG2706 3-carboxymuconate cyclase [Carbohydrate transport and metabolism]
Probab=98.49 E-value=0.00028 Score=63.05 Aligned_cols=203 Identities=12% Similarity=0.177 Sum_probs=131.1
Q ss_pred CeEEEEEcCCCCEEEEEcC-Cc-EEEEEecCCceeEEe--eeecCCc----------eEEEEEecCCCeEEEEeCCCCCC
Q 020784 87 TLLHISFNQDHGCFAAGTD-HG-FRIYNCDPFREIFRR--DFERGGG----------IGVVEMLFRCNILALVGGGPDPQ 152 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~-~g-v~vw~~~~~~~~~~~--~~~~~~~----------v~~v~~~~~~~~~~~~sg~~~~~ 152 (321)
+-..|+++++|++|+++.- .+ |.++-++..+.+... ...|.+. +-...+.+++++++++.-|.
T Consensus 90 ~p~yvsvd~~g~~vf~AnY~~g~v~v~p~~~dG~l~~~v~~~~h~g~~p~~rQ~~~h~H~a~~tP~~~~l~v~DLG~--- 166 (346)
T COG2706 90 PPCYVSVDEDGRFVFVANYHSGSVSVYPLQADGSLQPVVQVVKHTGSGPHERQESPHVHSANFTPDGRYLVVPDLGT--- 166 (346)
T ss_pred CCeEEEECCCCCEEEEEEccCceEEEEEcccCCccccceeeeecCCCCCCccccCCccceeeeCCCCCEEEEeecCC---
Confidence 3388999999999999986 33 779987553322111 1112332 45566778888888887553
Q ss_pred CCCCcEEEEeCCCCcEEEE----EeeCCceeEEEEeCCe--EEEE--ECCEEEEEEcCCc----EEEEEEec----cCCC
Q 020784 153 YPLNKVMIWDDHQSRCIGE----LSFRSEVRSVKLRRDR--IIVV--LEQKIFVYNFADL----KLLHQIET----IANP 216 (321)
Q Consensus 153 ~~d~~v~iWD~~~~~~~~~----~~~~~~v~~v~~~~~~--~~~~--~~~~I~iwd~~~~----~~~~~l~~----~~~~ 216 (321)
..|.+|++..|..... ++-..-.+-+.||++. .++. .+++|.+|..... +.++++.. ....
T Consensus 167 ---Dri~~y~~~dg~L~~~~~~~v~~G~GPRHi~FHpn~k~aY~v~EL~stV~v~~y~~~~g~~~~lQ~i~tlP~dF~g~ 243 (346)
T COG2706 167 ---DRIFLYDLDDGKLTPADPAEVKPGAGPRHIVFHPNGKYAYLVNELNSTVDVLEYNPAVGKFEELQTIDTLPEDFTGT 243 (346)
T ss_pred ---ceEEEEEcccCccccccccccCCCCCcceEEEcCCCcEEEEEeccCCEEEEEEEcCCCceEEEeeeeccCccccCCC
Confidence 4699999998765432 2222356778999874 3333 4689999998652 33333322 1223
Q ss_pred CceEEEeeCCCceEEEeecCCCCcEEEEeeC--CcceEEe---eccccceeEEEECCCCCEEEEEeCCCcEEEEEEcC--
Q 020784 217 KGLCAVSQGVGSLVLVCPGLQKGQVRVEHYA--SKRTKFI---MAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTL-- 289 (321)
Q Consensus 217 ~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~--~~~~~~l---~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~-- 289 (321)
....++...+||.+|.+|-.....|-++.+. ++.+... .-|....+...|++.|++|+.+.+|+..|.||.+.
T Consensus 244 ~~~aaIhis~dGrFLYasNRg~dsI~~f~V~~~~g~L~~~~~~~teg~~PR~F~i~~~g~~Liaa~q~sd~i~vf~~d~~ 323 (346)
T COG2706 244 NWAAAIHISPDGRFLYASNRGHDSIAVFSVDPDGGKLELVGITPTEGQFPRDFNINPSGRFLIAANQKSDNITVFERDKE 323 (346)
T ss_pred CceeEEEECCCCCEEEEecCCCCeEEEEEEcCCCCEEEEEEEeccCCcCCccceeCCCCCEEEEEccCCCcEEEEEEcCC
Confidence 4566777777889888655444466665443 2333322 23444589999999999999999888779999775
Q ss_pred CCcEEE
Q 020784 290 DGTLLQ 295 (321)
Q Consensus 290 tg~~i~ 295 (321)
||++-.
T Consensus 324 TG~L~~ 329 (346)
T COG2706 324 TGRLTL 329 (346)
T ss_pred CceEEe
Confidence 566543
No 271
>PLN02919 haloacid dehalogenase-like hydrolase family protein
Probab=98.49 E-value=0.00027 Score=74.17 Aligned_cols=216 Identities=10% Similarity=0.051 Sum_probs=123.7
Q ss_pred EEEEEcCC-CCEEEEEcC-CcEEEEEecCCceeEEeeeec----CC--------ceEEEEEecCCCeEEEEeCCCCCCCC
Q 020784 89 LHISFNQD-HGCFAAGTD-HGFRIYNCDPFREIFRRDFER----GG--------GIGVVEMLFRCNILALVGGGPDPQYP 154 (321)
Q Consensus 89 ~~v~fs~d-g~~lasg~~-~gv~vw~~~~~~~~~~~~~~~----~~--------~v~~v~~~~~~~~~~~~sg~~~~~~~ 154 (321)
..++++++ |+++++-.. +.|++||.+............ ++ .-..+++..+++.+.++..+
T Consensus 571 ~gvavd~~~g~lyVaDs~n~rI~v~d~~G~~i~~ig~~g~~G~~dG~~~~a~f~~P~GIavd~~gn~LYVaDt~------ 644 (1057)
T PLN02919 571 GKLAIDLLNNRLFISDSNHNRIVVTDLDGNFIVQIGSTGEEGLRDGSFEDATFNRPQGLAYNAKKNLLYVADTE------ 644 (1057)
T ss_pred ceEEEECCCCeEEEEECCCCeEEEEeCCCCEEEEEccCCCcCCCCCchhccccCCCcEEEEeCCCCEEEEEeCC------
Confidence 35788875 556666555 447788875432211111000 00 11344555566666555422
Q ss_pred CCcEEEEeCCCCcEEEEEee------------------CCceeEEEEeC--CeEEEEE--CCEEEEEEcCCcEEEEEEec
Q 020784 155 LNKVMIWDDHQSRCIGELSF------------------RSEVRSVKLRR--DRIIVVL--EQKIFVYNFADLKLLHQIET 212 (321)
Q Consensus 155 d~~v~iWD~~~~~~~~~~~~------------------~~~v~~v~~~~--~~~~~~~--~~~I~iwd~~~~~~~~~l~~ 212 (321)
.+.|+++|..++.. .++.. -.....+++++ ..++++. ++.|++||..++... .+.+
T Consensus 645 n~~Ir~id~~~~~V-~tlag~G~~g~~~~gg~~~~~~~ln~P~gVa~dp~~g~LyVad~~~~~I~v~d~~~g~v~-~~~G 722 (1057)
T PLN02919 645 NHALREIDFVNETV-RTLAGNGTKGSDYQGGKKGTSQVLNSPWDVCFEPVNEKVYIAMAGQHQIWEYNISDGVTR-VFSG 722 (1057)
T ss_pred CceEEEEecCCCEE-EEEeccCcccCCCCCChhhhHhhcCCCeEEEEecCCCeEEEEECCCCeEEEEECCCCeEE-EEec
Confidence 37799999877653 23211 01346788886 3455553 369999999776542 3321
Q ss_pred cC---------------CCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEEeec---------------------
Q 020784 213 IA---------------NPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKFIMA--------------------- 256 (321)
Q Consensus 213 ~~---------------~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~--------------------- 256 (321)
.. ..-.-+++++ ++..|.++...++.|++||..++....+.+
T Consensus 723 ~G~~~~~~g~~~~~~~~~~P~GIavsp--dG~~LYVADs~n~~Irv~D~~tg~~~~~~gg~~~~~~~l~~fG~~dG~g~~ 800 (1057)
T PLN02919 723 DGYERNLNGSSGTSTSFAQPSGISLSP--DLKELYIADSESSSIRALDLKTGGSRLLAGGDPTFSDNLFKFGDHDGVGSE 800 (1057)
T ss_pred CCccccCCCCccccccccCccEEEEeC--CCCEEEEEECCCCeEEEEECCCCcEEEEEecccccCcccccccCCCCchhh
Confidence 10 0001244444 444333346778899999987544321110
Q ss_pred -cccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCC--------------CcceeEEEeecCceE
Q 020784 257 -HDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCP--------------SISAQSGLWLSSAWL 315 (321)
Q Consensus 257 -H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g--------------~~~~~~~~s~d~~~l 315 (321)
.-.....|+|+++|.++++-+.+++ |++||..++.+....-.| .....++++.+|+.+
T Consensus 801 ~~l~~P~Gvavd~dG~LYVADs~N~r-IrviD~~tg~v~tiaG~G~~G~~dG~~~~a~l~~P~GIavd~dG~ly 873 (1057)
T PLN02919 801 VLLQHPLGVLCAKDGQIYVADSYNHK-IKKLDPATKRVTTLAGTGKAGFKDGKALKAQLSEPAGLALGENGRLF 873 (1057)
T ss_pred hhccCCceeeEeCCCcEEEEECCCCE-EEEEECCCCeEEEEeccCCcCCCCCcccccccCCceEEEEeCCCCEE
Confidence 1123579999999999998888888 999999988765433222 123456777888744
No 272
>KOG1240 consensus Protein kinase containing WD40 repeats [Signal transduction mechanisms]
Probab=98.47 E-value=9.2e-06 Score=82.09 Aligned_cols=172 Identities=11% Similarity=0.079 Sum_probs=105.7
Q ss_pred cCCceEEEEEe-cCCCeEEEEeCCCCCCCCCCcEEEEeCCCC-----cEEEEEee---CCceeEE--EEeCCeEEEEE-C
Q 020784 126 RGGGIGVVEML-FRCNILALVGGGPDPQYPLNKVMIWDDHQS-----RCIGELSF---RSEVRSV--KLRRDRIIVVL-E 193 (321)
Q Consensus 126 ~~~~v~~v~~~-~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~-----~~~~~~~~---~~~v~~v--~~~~~~~~~~~-~ 193 (321)
|...+..++.+ .++.++++++ +||+||+||.++- ....++.. .+.+.++ +.+.+.+++++ |
T Consensus 1047 hs~~v~k~a~s~~~~s~FvsgS-------~DGtVKvW~~~k~~~~~~s~rS~ltys~~~sr~~~vt~~~~~~~~Av~t~D 1119 (1431)
T KOG1240|consen 1047 HSSAVIKLAVSSEHTSLFVSGS-------DDGTVKVWNLRKLEGEGGSARSELTYSPEGSRVEKVTMCGNGDQFAVSTKD 1119 (1431)
T ss_pred ccccccceeecCCCCceEEEec-------CCceEEEeeehhhhcCcceeeeeEEEeccCCceEEEEeccCCCeEEEEcCC
Confidence 34444444444 3446676666 7899999997542 12222332 2345554 45567787775 5
Q ss_pred CEEEEEEcCCc-------EEEEEEeccCCCC--ceEEEeeCCCceEEEeecCCCCcEEEEeeCCcce-E--Eeeccccce
Q 020784 194 QKIFVYNFADL-------KLLHQIETIANPK--GLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRT-K--FIMAHDSRI 261 (321)
Q Consensus 194 ~~I~iwd~~~~-------~~~~~l~~~~~~~--~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~-~--~l~~H~~~V 261 (321)
|.|++.++... ...+....+..+. ...++........+++ +...+.|.+||...... - ....-.+.|
T Consensus 1120 G~v~~~~id~~~~~~~~~~~~ri~n~~~~g~vv~m~a~~~~~~S~~lvy-~T~~~~iv~~D~r~~~~~w~lk~~~~hG~v 1198 (1431)
T KOG1240|consen 1120 GSVRVLRIDHYNVSKRVATQVRIPNLKKDGVVVSMHAFTAIVQSHVLVY-ATDLSRIVSWDTRMRHDAWRLKNQLRHGLV 1198 (1431)
T ss_pred CeEEEEEccccccccceeeeeecccccCCCceEEeecccccccceeEEE-EEeccceEEecchhhhhHHhhhcCccccce
Confidence 79999988541 1122222222211 1112222111124554 67778888899765432 2 333456789
Q ss_pred eEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeE
Q 020784 262 ACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQS 306 (321)
Q Consensus 262 ~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~ 306 (321)
++++.+|-+..|+.|...|. +-+||++=+..+...+..+...+.
T Consensus 1199 TSi~idp~~~WlviGts~G~-l~lWDLRF~~~i~sw~~P~~~~i~ 1242 (1431)
T KOG1240|consen 1199 TSIVIDPWCNWLVIGTSRGQ-LVLWDLRFRVPILSWEHPARAPIR 1242 (1431)
T ss_pred eEEEecCCceEEEEecCCce-EEEEEeecCceeecccCcccCCcc
Confidence 99999999999999999999 889999998888887766664433
No 273
>KOG4190 consensus Uncharacterized conserved protein [Function unknown]
Probab=98.42 E-value=5.1e-07 Score=84.04 Aligned_cols=164 Identities=15% Similarity=0.198 Sum_probs=109.5
Q ss_pred cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCC-Cc------EEEEEe-eCCceeEEEEeCCe-EEEEECCEE
Q 020784 126 RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQ-SR------CIGELS-FRSEVRSVKLRRDR-IIVVLEQKI 196 (321)
Q Consensus 126 ~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~-~~------~~~~~~-~~~~v~~v~~~~~~-~~~~~~~~I 196 (321)
|...|..+...-+.|.++.++ .|++||+|.++. +. |..+.+ +..+|..+.|-.+. .++.+|+.|
T Consensus 734 H~~~iRai~AidNENSFiSAS-------kDKTVKLWSik~EgD~~~tsaCQfTY~aHkk~i~~igfL~~lr~i~ScD~gi 806 (1034)
T KOG4190|consen 734 HQEKIRAIAAIDNENSFISAS-------KDKTVKLWSIKPEGDEIGTSACQFTYQAHKKPIHDIGFLADLRSIASCDGGI 806 (1034)
T ss_pred cHHHhHHHHhcccccceeecc-------CCceEEEEEeccccCccccceeeeEhhhccCcccceeeeeccceeeeccCcc
Confidence 445566665556667777776 789999998753 22 333333 33478888887665 455578899
Q ss_pred EEEEcCCcEEEEEEecc--CCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEe-----eccccceeEEEECC
Q 020784 197 FVYNFADLKLLHQIETI--ANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFI-----MAHDSRIACFALTQ 268 (321)
Q Consensus 197 ~iwd~~~~~~~~~l~~~--~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l-----~~H~~~V~~vafsp 268 (321)
.+||.--+.++...... ....+.+..-++-+..++.+-++...+|++.|.+... ...+ .+-+.-+++++.-+
T Consensus 807 HlWDPFigr~Laq~~dapk~~a~~~ikcl~nv~~~iliAgcsaeSTVKl~DaRsce~~~E~kVcna~~Pna~~R~iaVa~ 886 (1034)
T KOG4190|consen 807 HLWDPFIGRLLAQMEDAPKEGAGGNIKCLENVDRHILIAGCSAESTVKLFDARSCEWTCELKVCNAPGPNALTRAIAVAD 886 (1034)
T ss_pred eeecccccchhHhhhcCcccCCCceeEecccCcchheeeeccchhhheeeecccccceeeEEeccCCCCchheeEEEecc
Confidence 99998766666543221 1122222222332334554334888899998876543 2233 34456799999999
Q ss_pred CCCEEEEEeCCCcEEEEEEcCCCcEEEEE
Q 020784 269 DGQLLATSSTKGTLVRIFNTLDGTLLQEE 297 (321)
Q Consensus 269 dg~~las~S~Dgt~IrIWd~~tg~~i~~~ 297 (321)
.|++||.+=..|+ |.+.|.++|+.+...
T Consensus 887 ~GN~lAa~LSnGc-i~~LDaR~G~vINsw 914 (1034)
T KOG4190|consen 887 KGNKLAAALSNGC-IAILDARNGKVINSW 914 (1034)
T ss_pred CcchhhHHhcCCc-EEEEecCCCceeccC
Confidence 9999999988999 999999999998865
No 274
>KOG1409 consensus Uncharacterized conserved protein, contains WD40 repeats and FYVE domains [Function unknown]
Probab=98.39 E-value=1.4e-05 Score=70.73 Aligned_cols=195 Identities=12% Similarity=0.256 Sum_probs=115.0
Q ss_pred CCCeEEEEEcCCCCEEEEEcCCc-EEEEEec-CC-ceeEEee-eecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 85 PPTLLHISFNQDHGCFAAGTDHG-FRIYNCD-PF-REIFRRD-FERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 85 ~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~-~~-~~~~~~~-~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
+.+++++.+..+.+.|.+|-+.| +-=+.+. .. +..+.+. ..|...+..+-+.-....+++.+ . .+-..
T Consensus 68 P~~~~~~~y~~e~~~L~vg~~ngtvtefs~sedfnkm~~~r~~~~h~~~v~~~if~~~~e~V~s~~-------~-dk~~~ 139 (404)
T KOG1409|consen 68 PSPCSAMEYVSESRRLYVGQDNGTVTEFALSEDFNKMTFLKDYLAHQARVSAIVFSLTHEWVLSTG-------K-DKQFA 139 (404)
T ss_pred CCCceEeeeeccceEEEEEEecceEEEEEhhhhhhhcchhhhhhhhhcceeeEEecCCceeEEEec-------c-ccceE
Confidence 35899999999999999998866 4344331 11 1111111 11455555554444444444444 2 23334
Q ss_pred EeC-CCCcEEEEEeeCCceeEEEEeCCeEEEE-ECCEEEEEEc--CCcEEEEEEeccCCCCceEEEeeCCCceEEEeecC
Q 020784 161 WDD-HQSRCIGELSFRSEVRSVKLRRDRIIVV-LEQKIFVYNF--ADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGL 236 (321)
Q Consensus 161 WD~-~~~~~~~~~~~~~~v~~v~~~~~~~~~~-~~~~I~iwd~--~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs 236 (321)
|-. +.++.+....+...-.++.+.-....++ ..++|.+-.+ ....++.++.+|...+ .+.++++...+|. ||.
T Consensus 140 ~hc~e~~~~lg~Y~~~~~~t~~~~d~~~~fvGd~~gqvt~lr~~~~~~~~i~~~~~h~~~~--~~l~Wd~~~~~Lf-Sg~ 216 (404)
T KOG1409|consen 140 WHCTESGNRLGGYNFETPASALQFDALYAFVGDHSGQITMLKLEQNGCQLITTFNGHTGEV--TCLKWDPGQRLLF-SGA 216 (404)
T ss_pred EEeeccCCcccceEeeccCCCCceeeEEEEecccccceEEEEEeecCCceEEEEcCcccce--EEEEEcCCCcEEE-ecc
Confidence 543 2222222111111111111111111122 1234443333 4566777888776654 4455565556665 799
Q ss_pred CCCcEEEEeeCCcc--eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCC
Q 020784 237 QKGQVRVEHYASKR--TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDG 291 (321)
Q Consensus 237 ~dg~V~i~d~~~~~--~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg 291 (321)
.|..|.+||+..++ ...+.+|...|+.+..-+--+.|.++++||. |-+||+...
T Consensus 217 ~d~~vi~wdigg~~g~~~el~gh~~kV~~l~~~~~t~~l~S~~edg~-i~~w~mn~~ 272 (404)
T KOG1409|consen 217 SDHSVIMWDIGGRKGTAYELQGHNDKVQALSYAQHTRQLISCGEDGG-IVVWNMNVK 272 (404)
T ss_pred ccCceEEEeccCCcceeeeeccchhhhhhhhhhhhheeeeeccCCCe-EEEEeccce
Confidence 99999999987654 5688999999999999888889999999999 999998754
No 275
>KOG1354 consensus Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=98.35 E-value=3.4e-05 Score=68.36 Aligned_cols=168 Identities=15% Similarity=0.166 Sum_probs=106.2
Q ss_pred CCCCCCcccCCCCCCeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEE----eeee---cCCceEEEEEecC-CCeEEE
Q 020784 73 LPSPAESTSSSPPPTLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFR----RDFE---RGGGIGVVEMLFR-CNILAL 144 (321)
Q Consensus 73 ~~~~~~~~~~~~~~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~----~~~~---~~~~v~~v~~~~~-~~~~~~ 144 (321)
....+......|.--|++|+++.|+..+.++.+=.|-+|+++-....+. +... -...|...++++. ++.++-
T Consensus 152 ea~prRv~aNaHtyhiNSIS~NsD~Et~lSADdLRINLWnlei~d~sFnIVDIKP~nmEeLteVITsaEFhp~~cn~f~Y 231 (433)
T KOG1354|consen 152 EASPRRVYANAHTYHINSISVNSDKETFLSADDLRINLWNLEIIDQSFNIVDIKPANMEELTEVITSAEFHPHHCNVFVY 231 (433)
T ss_pred eeeeeeeccccceeEeeeeeecCccceEeeccceeeeeccccccCCceeEEEccccCHHHHHHHHhhhccCHhHccEEEE
Confidence 3334445557788899999999999999998877788999864332221 1110 0124556677664 444544
Q ss_pred EeCCCCCCCCCCcEEEEeCCCCcEEE----EEee-------------CCceeEEEEeCCeEEEEE-C-CEEEEEEc-CCc
Q 020784 145 VGGGPDPQYPLNKVMIWDDHQSRCIG----ELSF-------------RSEVRSVKLRRDRIIVVL-E-QKIFVYNF-ADL 204 (321)
Q Consensus 145 ~sg~~~~~~~d~~v~iWD~~~~~~~~----~~~~-------------~~~v~~v~~~~~~~~~~~-~-~~I~iwd~-~~~ 204 (321)
.+ +.|+||+-|++...+.- .+.. -..|..+.|++.+-++.+ + -+|++||+ ...
T Consensus 232 SS-------SKGtIrLcDmR~~aLCd~hsKlfEepedp~~rsffseiIsSISDvKFs~sGryilsRDyltvk~wD~nme~ 304 (433)
T KOG1354|consen 232 SS-------SKGTIRLCDMRQSALCDAHSKLFEEPEDPSSRSFFSEIISSISDVKFSHSGRYILSRDYLTVKLWDLNMEA 304 (433)
T ss_pred ec-------CCCcEEEeechhhhhhcchhhhhccccCCcchhhHHHHhhhhhceEEccCCcEEEEeccceeEEEeccccC
Confidence 44 56999999998543211 1111 124667889887555544 4 49999999 566
Q ss_pred EEEEEEeccCCC-------------CceEEEeeCCCceEEEeecCCCCcEEEEeeCC
Q 020784 205 KLLHQIETIANP-------------KGLCAVSQGVGSLVLVCPGLQKGQVRVEHYAS 248 (321)
Q Consensus 205 ~~~~~l~~~~~~-------------~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~ 248 (321)
+.+.+++.|..- ..-.-++++++...+. +|+....+++++...
T Consensus 305 ~pv~t~~vh~~lr~kLc~lYEnD~IfdKFec~~sg~~~~v~-TGsy~n~frvf~~~~ 360 (433)
T KOG1354|consen 305 KPVETYPVHEYLRSKLCSLYENDAIFDKFECSWSGNDSYVM-TGSYNNVFRVFNLAR 360 (433)
T ss_pred CcceEEeehHhHHHHHHHHhhccchhheeEEEEcCCcceEe-cccccceEEEecCCC
Confidence 777777655321 1122344555656666 699999999988543
No 276
>KOG4714 consensus Nucleoporin [Nuclear structure]
Probab=98.33 E-value=1.9e-06 Score=73.45 Aligned_cols=94 Identities=16% Similarity=0.196 Sum_probs=63.2
Q ss_pred CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc--eEEeeccccceeEEEECCC-C
Q 020784 194 QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR--TKFIMAHDSRIACFALTQD-G 270 (321)
Q Consensus 194 ~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~--~~~l~~H~~~V~~vafspd-g 270 (321)
+..+.|+++..+.+..-......+...+.++.. +-+++.|+.||.+-+||..... ...+++|+.+++.|-|+|. +
T Consensus 159 d~~~a~~~~p~~t~~~~~~~~~~v~~l~~hp~q--q~~v~cgt~dg~~~l~d~rn~~~p~S~l~ahk~~i~eV~FHpk~p 236 (319)
T KOG4714|consen 159 DNFYANTLDPIKTLIPSKKALDAVTALCSHPAQ--QHLVCCGTDDGIVGLWDARNVAMPVSLLKAHKAEIWEVHFHPKNP 236 (319)
T ss_pred cceeeecccccccccccccccccchhhhCCccc--ccEEEEecCCCeEEEEEcccccchHHHHHHhhhhhhheeccCCCc
Confidence 566667765433221111111123344444443 4344459999999999987654 3378999999999999975 6
Q ss_pred CEEEEEeCCCcEEEEEEcCC
Q 020784 271 QLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 271 ~~las~S~Dgt~IrIWd~~t 290 (321)
..|.|+|+||. +--||..+
T Consensus 237 ~~Lft~sedGs-lw~wdas~ 255 (319)
T KOG4714|consen 237 EHLFTCSEDGS-LWHWDAST 255 (319)
T ss_pred hheeEecCCCc-EEEEcCCC
Confidence 78999999999 77888775
No 277
>PF04762 IKI3: IKI3 family; InterPro: IPR006849 Members of this family are components of the elongator multi-subunit component of a novel RNA polymerase II holoenzyme for transcriptional elongation [].
Probab=98.32 E-value=0.00013 Score=75.17 Aligned_cols=223 Identities=15% Similarity=0.115 Sum_probs=131.0
Q ss_pred CCCCeEEEEEcCCCCEEEEEcCCc-EEEE----EecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcE
Q 020784 84 PPPTLLHISFNQDHGCFAAGTDHG-FRIY----NCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~~g-v~vw----~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
..+.|.++.|-+|...|..+..+| |.+. +.+....+..-.. +.+|.+++|+|+...+++++|. ++|
T Consensus 74 ~~~~ivs~~yl~d~~~l~~~~~~Gdi~~~~~~~~~~~~~~E~VG~v--d~GI~a~~WSPD~Ella~vT~~-------~~l 144 (928)
T PF04762_consen 74 PNDKIVSFQYLADSESLCIALASGDIILVREDPDPDEDEIEIVGSV--DSGILAASWSPDEELLALVTGE-------GNL 144 (928)
T ss_pred CCCcEEEEEeccCCCcEEEEECCceEEEEEccCCCCCceeEEEEEE--cCcEEEEEECCCcCEEEEEeCC-------CEE
Confidence 346899999999998888888766 5666 5555555555555 7889999999999999999953 677
Q ss_pred EEEeCCCCcEEEEEeeCC------ceeEEEEeCCeE-EEEECCEEEEEEcCCcEEEEEEecc--CCCCceEEEeeCCCce
Q 020784 159 MIWDDHQSRCIGELSFRS------EVRSVKLRRDRI-IVVLEQKIFVYNFADLKLLHQIETI--ANPKGLCAVSQGVGSL 229 (321)
Q Consensus 159 ~iWD~~~~~~~~~~~~~~------~v~~v~~~~~~~-~~~~~~~I~iwd~~~~~~~~~l~~~--~~~~~~~~~s~~~d~~ 229 (321)
.+.. ++.+.+.+..... ...+|-|..+.. +=+..++-.-=.+++...- +.+.. ......+.+++.+||.
T Consensus 145 ~~mt-~~fd~i~E~~l~~~~~~~~~~VsVGWGkKeTQF~Gs~gK~aa~~~~~p~~~-~~d~~~~s~dd~~~~ISWRGDG~ 222 (928)
T PF04762_consen 145 LLMT-RDFDPISEVPLDSDDFGESKHVSVGWGKKETQFHGSAGKAAARQLRDPTVP-KVDEGKLSWDDGRVRISWRGDGE 222 (928)
T ss_pred EEEe-ccceEEEEeecCccccCCCceeeeccCcccCccCcchhhhhhhhccCCCCC-ccccCccccCCCceEEEECCCCc
Confidence 7664 5556666554432 122333332210 0000000000000000000 00000 0223567899999999
Q ss_pred EEEeecC--CC---CcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeC--CCcEEEEEEcCCCcEEEEEeCC--
Q 020784 230 VLVCPGL--QK---GQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSST--KGTLVRIFNTLDGTLLQEECCP-- 300 (321)
Q Consensus 230 ~la~sGs--~d---g~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~--Dgt~IrIWd~~tg~~i~~~~~g-- 300 (321)
++|++.- .. ..++||+....-..+-..-.+--.+++|-|.|.++|+... ++..|.+|. ++|-.-.+|.-.
T Consensus 223 yFAVss~~~~~~~~R~iRVy~ReG~L~stSE~v~gLe~~l~WrPsG~lIA~~q~~~~~~~VvFfE-rNGLrhgeF~l~~~ 301 (928)
T PF04762_consen 223 YFAVSSVEPETGSRRVIRVYSREGELQSTSEPVDGLEGALSWRPSGNLIASSQRLPDRHDVVFFE-RNGLRHGEFTLRFD 301 (928)
T ss_pred EEEEEEEEcCCCceeEEEEECCCceEEeccccCCCccCCccCCCCCCEEEEEEEcCCCcEEEEEe-cCCcEeeeEecCCC
Confidence 9998542 23 4788898763222233333334567899999999999765 333366676 455554554322
Q ss_pred ---CcceeEEEeecCceEEEe
Q 020784 301 ---SISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 301 ---~~~~~~~~s~d~~~la~~ 318 (321)
.....+..+.||..||+.
T Consensus 302 ~~~~~v~~l~Wn~ds~iLAv~ 322 (928)
T PF04762_consen 302 PEEEKVIELAWNSDSEILAVW 322 (928)
T ss_pred CCCceeeEEEECCCCCEEEEE
Confidence 223345777888999984
No 278
>PF03178 CPSF_A: CPSF A subunit region; InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=98.31 E-value=0.00046 Score=62.88 Aligned_cols=177 Identities=13% Similarity=0.231 Sum_probs=109.1
Q ss_pred EEEEEecCCceeEEeeeecCCceEEEEE-ecC------CCeEEEEeC---CCCCCCCCCcEEEEeCCCC-------cEEE
Q 020784 108 FRIYNCDPFREIFRRDFERGGGIGVVEM-LFR------CNILALVGG---GPDPQYPLNKVMIWDDHQS-------RCIG 170 (321)
Q Consensus 108 v~vw~~~~~~~~~~~~~~~~~~v~~v~~-~~~------~~~~~~~sg---~~~~~~~d~~v~iWD~~~~-------~~~~ 170 (321)
|+|.|-.+.+.+....+..+..+.+++. .+. ..+++++++ +.+.....|.|.++++.+. +.+.
T Consensus 4 i~l~d~~~~~~~~~~~l~~~E~~~s~~~~~l~~~~~~~~~~ivVGT~~~~~~~~~~~~Gri~v~~i~~~~~~~~~l~~i~ 83 (321)
T PF03178_consen 4 IRLVDPTTFEVLDSFELEPNEHVTSLCSVKLKGDSTGKKEYIVVGTAFNYGEDPEPSSGRILVFEISESPENNFKLKLIH 83 (321)
T ss_dssp EEEEETTTSSEEEEEEEETTEEEEEEEEEEETTS---SSEEEEEEEEE--TTSSS-S-EEEEEEEECSS-----EEEEEE
T ss_pred EEEEeCCCCeEEEEEECCCCceEEEEEEEEEcCccccccCEEEEEecccccccccccCcEEEEEEEEcccccceEEEEEE
Confidence 5677777776666666633333443332 333 234444433 1111112288999999884 2344
Q ss_pred EEeeCCceeEEEEeCCeEEEEECCEEEEEEcCCcE-EEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEE--EeeC
Q 020784 171 ELSFRSEVRSVKLRRDRIIVVLEQKIFVYNFADLK-LLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRV--EHYA 247 (321)
Q Consensus 171 ~~~~~~~v~~v~~~~~~~~~~~~~~I~iwd~~~~~-~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i--~d~~ 247 (321)
.....+.|++++--.+.++++.++.|++|++...+ ++.. .....+..+.++.... .++++ |+..+.|.+ |+..
T Consensus 84 ~~~~~g~V~ai~~~~~~lv~~~g~~l~v~~l~~~~~l~~~-~~~~~~~~i~sl~~~~--~~I~v-gD~~~sv~~~~~~~~ 159 (321)
T PF03178_consen 84 STEVKGPVTAICSFNGRLVVAVGNKLYVYDLDNSKTLLKK-AFYDSPFYITSLSVFK--NYILV-GDAMKSVSLLRYDEE 159 (321)
T ss_dssp EEEESS-EEEEEEETTEEEEEETTEEEEEEEETTSSEEEE-EEE-BSSSEEEEEEET--TEEEE-EESSSSEEEEEEETT
T ss_pred EEeecCcceEhhhhCCEEEEeecCEEEEEEccCcccchhh-heecceEEEEEEeccc--cEEEE-EEcccCEEEEEEEcc
Confidence 56677899999988888999999999999997766 4333 2233344666666654 35554 777667776 4543
Q ss_pred CcceEEeec--cccceeEEEECCCCCEEEEEeCCCcEEEEEEcC
Q 020784 248 SKRTKFIMA--HDSRIACFALTQDGQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 248 ~~~~~~l~~--H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~ 289 (321)
...+..+.. ....++++.|-+|+..++.+..+|. |.++...
T Consensus 160 ~~~l~~va~d~~~~~v~~~~~l~d~~~~i~~D~~gn-l~~l~~~ 202 (321)
T PF03178_consen 160 NNKLILVARDYQPRWVTAAEFLVDEDTIIVGDKDGN-LFVLRYN 202 (321)
T ss_dssp TE-EEEEEEESS-BEEEEEEEE-SSSEEEEEETTSE-EEEEEE-
T ss_pred CCEEEEEEecCCCccEEEEEEecCCcEEEEEcCCCe-EEEEEEC
Confidence 444443332 4556899999877778888999999 9999887
No 279
>COG5354 Uncharacterized protein, contains Trp-Asp (WD) repeat [General function prediction only]
Probab=98.29 E-value=0.00053 Score=63.80 Aligned_cols=160 Identities=8% Similarity=0.050 Sum_probs=97.7
Q ss_pred CCcEEEEeCCCCcEEEEEeeCC-ceeEEEEeCC--eEEEEE------------CCEEEEEEcCCcEEEEEEeccCCCCce
Q 020784 155 LNKVMIWDDHQSRCIGELSFRS-EVRSVKLRRD--RIIVVL------------EQKIFVYNFADLKLLHQIETIANPKGL 219 (321)
Q Consensus 155 d~~v~iWD~~~~~~~~~~~~~~-~v~~v~~~~~--~~~~~~------------~~~I~iwd~~~~~~~~~l~~~~~~~~~ 219 (321)
+..++||.+-.+..+.+..+-. .-..+.|+.. .+++.. ...+.+++++...+ .....-..++.-
T Consensus 201 pa~~~i~sIp~~s~l~tk~lfk~~~~qLkW~~~g~~ll~l~~t~~ksnKsyfgesnLyl~~~~e~~i-~V~~~~~~pVhd 279 (561)
T COG5354 201 PAMVRILSIPKNSVLVTKNLFKVSGVQLKWQVLGKYLLVLVMTHTKSNKSYFGESNLYLLRITERSI-PVEKDLKDPVHD 279 (561)
T ss_pred CcEEEEEEccCCCeeeeeeeEeecccEEEEecCCceEEEEEEEeeecccceeccceEEEEeeccccc-ceecccccccee
Confidence 4566777666555444333211 2234555543 222211 14677888764332 222233455555
Q ss_pred EEEeeCCCceEEEeecCCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCC---cEEEEEEcCCCcEEE-
Q 020784 220 CAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKG---TLVRIFNTLDGTLLQ- 295 (321)
Q Consensus 220 ~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dg---t~IrIWd~~tg~~i~- 295 (321)
.++.+..++.- +++|-.+-.+.++|+... ..+..-...=+.+.|||.+++++.++.|+ . |-|||......+.
T Consensus 280 f~W~p~S~~F~-vi~g~~pa~~s~~~lr~N--l~~~~Pe~~rNT~~fsp~~r~il~agF~nl~gn-i~i~~~~~rf~~~~ 355 (561)
T COG5354 280 FTWEPLSSRFA-VISGYMPASVSVFDLRGN--LRFYFPEQKRNTIFFSPHERYILFAGFDNLQGN-IEIFDPAGRFKVAG 355 (561)
T ss_pred eeecccCCcee-EEecccccceeecccccc--eEEecCCcccccccccCcccEEEEecCCccccc-eEEeccCCceEEEE
Confidence 66666655443 446888888888887765 33444455567889999999999988764 6 8899998776655
Q ss_pred EEeCCCcceeEEEeecCceEEEeec
Q 020784 296 EECCPSISAQSGLWLSSAWLRVLRT 320 (321)
Q Consensus 296 ~~~~g~~~~~~~~s~d~~~la~~~~ 320 (321)
.+ .+......-+++||+|+.++.|
T Consensus 356 ~~-~~~n~s~~~wspd~qF~~~~~t 379 (561)
T COG5354 356 AF-NGLNTSYCDWSPDGQFYDTDTT 379 (561)
T ss_pred Ee-ecCCceEeeccCCceEEEecCC
Confidence 55 3454445567899999887654
No 280
>KOG0280 consensus Uncharacterized conserved protein [Amino acid transport and metabolism]
Probab=98.29 E-value=3.9e-05 Score=66.65 Aligned_cols=139 Identities=15% Similarity=0.133 Sum_probs=87.0
Q ss_pred CCCcEEEEeCCCCcEEEEEe---eCC-c---eeEEEEeC--CeEEEEE-CCEEEEEEcCCcEE--EEEEeccCCCCceEE
Q 020784 154 PLNKVMIWDDHQSRCIGELS---FRS-E---VRSVKLRR--DRIIVVL-EQKIFVYNFADLKL--LHQIETIANPKGLCA 221 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~~~~---~~~-~---v~~v~~~~--~~~~~~~-~~~I~iwd~~~~~~--~~~l~~~~~~~~~~~ 221 (321)
..|.|.++..........+. ... . -.++.|.. ..+++.. .+.+.+-+...+.+ +++.+.|.-+.-.+.
T Consensus 93 a~G~i~~~r~~~~~ss~~L~~ls~~ki~~~~~lslD~~~~~~~i~vs~s~G~~~~v~~t~~~le~vq~wk~He~E~Wta~ 172 (339)
T KOG0280|consen 93 ARGQIQLYRNDEDESSVHLRGLSSKKISVVEALSLDISTSGTKIFVSDSRGSISGVYETEMVLEKVQTWKVHEFEAWTAK 172 (339)
T ss_pred ccceEEEEeeccceeeeeecccchhhhhheeeeEEEeeccCceEEEEcCCCcEEEEecceeeeeecccccccceeeeeee
Confidence 35777777654333222221 111 1 23344543 3444443 35666555443333 346677766666666
Q ss_pred EeeCCCceEEEeecCCCCcEEEEeeCC-cc--eEEeeccccceeEEEEC-CCCCEEEEEeCCCcEEEEEEcCC-CcEEE
Q 020784 222 VSQGVGSLVLVCPGLQKGQVRVEHYAS-KR--TKFIMAHDSRIACFALT-QDGQLLATSSTKGTLVRIFNTLD-GTLLQ 295 (321)
Q Consensus 222 ~s~~~d~~~la~sGs~dg~V~i~d~~~-~~--~~~l~~H~~~V~~vafs-pdg~~las~S~Dgt~IrIWd~~t-g~~i~ 295 (321)
|+... .-++++|+.||.+.-||.+- +. -...+.|...|.+|.=+ |++.+++|||+|.. |++||+++ |+.+.
T Consensus 173 f~~~~--pnlvytGgDD~~l~~~D~R~p~~~i~~n~kvH~~GV~SI~ss~~~~~~I~TGsYDe~-i~~~DtRnm~kPl~ 248 (339)
T KOG0280|consen 173 FSDKE--PNLVYTGGDDGSLSCWDIRIPKTFIWHNSKVHTSGVVSIYSSPPKPTYIATGSYDEC-IRVLDTRNMGKPLF 248 (339)
T ss_pred cccCC--CceEEecCCCceEEEEEecCCcceeeecceeeecceEEEecCCCCCceEEEeccccc-eeeeehhcccCccc
Confidence 65543 34556899999999999872 22 12356799999999888 56899999999999 99999994 55544
No 281
>PF07433 DUF1513: Protein of unknown function (DUF1513); InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=98.29 E-value=0.0014 Score=58.40 Aligned_cols=220 Identities=15% Similarity=0.123 Sum_probs=125.5
Q ss_pred eEEEEEcC-CCCEEEEEcCCc--EEEEEecCCceeEEeeeecC-CceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeC
Q 020784 88 LLHISFNQ-DHGCFAAGTDHG--FRIYNCDPFREIFRRDFERG-GGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDD 163 (321)
Q Consensus 88 V~~v~fs~-dg~~lasg~~~g--v~vw~~~~~~~~~~~~~~~~-~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~ 163 (321)
...++.+| ++..++.+..-| ..+||+.+++......-..+ +=.....++.+++.+.+.-...+ ...|.|-|||.
T Consensus 7 gH~~a~~p~~~~avafaRRPG~~~~v~D~~~g~~~~~~~a~~gRHFyGHg~fs~dG~~LytTEnd~~--~g~G~IgVyd~ 84 (305)
T PF07433_consen 7 GHGVAAHPTRPEAVAFARRPGTFALVFDCRTGQLLQRLWAPPGRHFYGHGVFSPDGRLLYTTENDYE--TGRGVIGVYDA 84 (305)
T ss_pred ccceeeCCCCCeEEEEEeCCCcEEEEEEcCCCceeeEEcCCCCCEEecCEEEcCCCCEEEEeccccC--CCcEEEEEEEC
Confidence 34688899 556677777744 45999988876654432111 11234567889998887654332 13588999999
Q ss_pred C-CCcEEEEEeeCC-ceeEEEEeCCe--EEEEEC-------------------CEEEEEEcCCcEEEEEEec--cCCCCc
Q 020784 164 H-QSRCIGELSFRS-EVRSVKLRRDR--IIVVLE-------------------QKIFVYNFADLKLLHQIET--IANPKG 218 (321)
Q Consensus 164 ~-~~~~~~~~~~~~-~v~~v~~~~~~--~~~~~~-------------------~~I~iwd~~~~~~~~~l~~--~~~~~~ 218 (321)
. ..+.+.++...+ ....+.+.++. ++++-. ..+-+.|..+++++.+... ..+...
T Consensus 85 ~~~~~ri~E~~s~GIGPHel~l~pDG~tLvVANGGI~Thpd~GR~kLNl~tM~psL~~ld~~sG~ll~q~~Lp~~~~~lS 164 (305)
T PF07433_consen 85 ARGYRRIGEFPSHGIGPHELLLMPDGETLVVANGGIETHPDSGRAKLNLDTMQPSLVYLDARSGALLEQVELPPDLHQLS 164 (305)
T ss_pred cCCcEEEeEecCCCcChhhEEEcCCCCEEEEEcCCCccCcccCceecChhhcCCceEEEecCCCceeeeeecCccccccc
Confidence 8 556666776544 34556666654 444421 2355556667777666443 111122
Q ss_pred eEEEeeCCCceEEEeecCCCC-------cEEEEeeCCcceEE-------eeccccceeEEEECCCCCEEEEEeCCCcEEE
Q 020784 219 LCAVSQGVGSLVLVCPGLQKG-------QVRVEHYASKRTKF-------IMAHDSRIACFALTQDGQLLATSSTKGTLVR 284 (321)
Q Consensus 219 ~~~~s~~~d~~~la~sGs~dg-------~V~i~d~~~~~~~~-------l~~H~~~V~~vafspdg~~las~S~Dgt~Ir 284 (321)
+--+..++++..+.. .-..| -|-+++... .+.. ...-.++|=+|+++.+|.++|..|=-|..+.
T Consensus 165 iRHLa~~~~G~V~~a-~Q~qg~~~~~~PLva~~~~g~-~~~~~~~p~~~~~~l~~Y~gSIa~~~~g~~ia~tsPrGg~~~ 242 (305)
T PF07433_consen 165 IRHLAVDGDGTVAFA-MQYQGDPGDAPPLVALHRRGG-ALRLLPAPEEQWRRLNGYIGSIAADRDGRLIAVTSPRGGRVA 242 (305)
T ss_pred eeeEEecCCCcEEEE-EecCCCCCccCCeEEEEcCCC-cceeccCChHHHHhhCCceEEEEEeCCCCEEEEECCCCCEEE
Confidence 222233333332221 11111 111122111 1111 2334578999999999998877766666699
Q ss_pred EEEcCCCcEEEEEeCCCcceeEEEeecC
Q 020784 285 IFNTLDGTLLQEECCPSISAQSGLWLSS 312 (321)
Q Consensus 285 IWd~~tg~~i~~~~~g~~~~~~~~s~d~ 312 (321)
+||..+|+++.... -.+.+.++...++
T Consensus 243 ~~d~~tg~~~~~~~-l~D~cGva~~~~~ 269 (305)
T PF07433_consen 243 VWDAATGRLLGSVP-LPDACGVAPTDDG 269 (305)
T ss_pred EEECCCCCEeeccc-cCceeeeeecCCc
Confidence 99999999987663 3444555433333
No 282
>KOG0309 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=98.29 E-value=3.5e-06 Score=81.00 Aligned_cols=200 Identities=12% Similarity=0.087 Sum_probs=134.3
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeec--CCceEEEEEecCCC--eEEEEeCCCCCCCCCC
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFER--GGGIGVVEMLFRCN--ILALVGGGPDPQYPLN 156 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~--~~~v~~v~~~~~~~--~~~~~sg~~~~~~~d~ 156 (321)
+.+-.+.+..+.++|-|+-+|.++..|..+-|++....-..+-. | .-.+..+.|++... +-++.. +..
T Consensus 20 sl~v~~~~~a~si~p~grdi~lAsr~gl~i~dld~p~~ppr~l~-h~tpw~vad~qws~h~a~~~wiVst-------s~q 91 (1081)
T KOG0309|consen 20 SLKVDGGFNAVSINPSGRDIVLASRQGLYIIDLDDPFTPPRWLH-HITPWQVADVQWSPHPAKPYWIVST-------SNQ 91 (1081)
T ss_pred EEEecCcccceeeccccchhhhhhhcCeEEEeccCCCCCceeee-ccCcchhcceecccCCCCceeEEec-------Ccc
Confidence 33444578889999999999999999988888864432222221 1 22466677766543 223333 457
Q ss_pred cEEEEeCCCCc-EEEEEeeC---CceeEEEEeCC---eEEEEE-CCEEEEEEcCCc-EEEEEEeccCCCCceEEEeeCCC
Q 020784 157 KVMIWDDHQSR-CIGELSFR---SEVRSVKLRRD---RIIVVL-EQKIFVYNFADL-KLLHQIETIANPKGLCAVSQGVG 227 (321)
Q Consensus 157 ~v~iWD~~~~~-~~~~~~~~---~~v~~v~~~~~---~~~~~~-~~~I~iwd~~~~-~~~~~l~~~~~~~~~~~~s~~~d 227 (321)
+-.||++.... ...+|-.+ ..|+.+.|+++ .++.+. +..+..||++.- ..+..+.........+.++.. +
T Consensus 92 kaiiwnlA~ss~~aIef~lhghsraitd~n~~~q~pdVlatcsvdt~vh~wd~rSp~~p~ys~~~w~s~asqVkwnyk-~ 170 (1081)
T KOG0309|consen 92 KAIIWNLAKSSSNAIEFVLHGHSRAITDINFNPQHPDVLATCSVDTYVHAWDMRSPHRPFYSTSSWRSAASQVKWNYK-D 170 (1081)
T ss_pred hhhhhhhhcCCccceEEEEecCccceeccccCCCCCcceeeccccccceeeeccCCCcceeeeecccccCceeeeccc-C
Confidence 78899986432 22233332 36888888764 455554 459999999763 445555554444555666554 3
Q ss_pred ceEEEeecCCCCcEEEEeeCCc--ceEEeeccccceeEEEECCC-CCEEEEEeCCCcEEEEEEcCCCc
Q 020784 228 SLVLVCPGLQKGQVRVEHYASK--RTKFIMAHDSRIACFALTQD-GQLLATSSTKGTLVRIFNTLDGT 292 (321)
Q Consensus 228 ~~~la~sGs~dg~V~i~d~~~~--~~~~l~~H~~~V~~vafspd-g~~las~S~Dgt~IrIWd~~tg~ 292 (321)
..++| .+..+.|.+||...+ ++..+++|...|+.++|..- ...+.+++.||+ |+.||.....
T Consensus 171 p~vla--sshg~~i~vwd~r~gs~pl~s~K~~vs~vn~~~fnr~~~s~~~s~~~d~t-vkfw~y~kSt 235 (1081)
T KOG0309|consen 171 PNVLA--SSHGNDIFVWDLRKGSTPLCSLKGHVSSVNSIDFNRFKYSEIMSSSNDGT-VKFWDYSKST 235 (1081)
T ss_pred cchhh--hccCCceEEEeccCCCcceEEecccceeeehHHHhhhhhhhhcccCCCCc-eeeecccccc
Confidence 36776 366668999998754 47899999999999999853 556889999999 9999987644
No 283
>KOG1064 consensus RAVE (regulator of V-ATPase assembly) complex subunit RAV1/DMX protein, WD repeat superfamily [General function prediction only]
Probab=98.28 E-value=5.9e-06 Score=86.25 Aligned_cols=159 Identities=13% Similarity=0.070 Sum_probs=109.0
Q ss_pred CceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeC--CceeEEEEeCC--eEEEE-ECCEEEEEEcC
Q 020784 128 GGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFR--SEVRSVKLRRD--RIIVV-LEQKIFVYNFA 202 (321)
Q Consensus 128 ~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~--~~v~~v~~~~~--~~~~~-~~~~I~iwd~~ 202 (321)
..+..+.-++...+.++.+ .||.|++|....++.+..+... ..|+.+.|+.+ .+.++ .|+.+.+|...
T Consensus 2209 ~~v~r~~sHp~~~~Yltgs-------~dgsv~~~~w~~~~~v~~~rt~g~s~vtr~~f~~qGnk~~i~d~dg~l~l~q~~ 2281 (2439)
T KOG1064|consen 2209 ENVRRMTSHPSDPYYLTGS-------QDGSVRMFEWGHGQQVVCFRTAGNSRVTRSRFNHQGNKFGIVDGDGDLSLWQAS 2281 (2439)
T ss_pred CceeeecCCCCCceEEecC-------CCceEEEEeccCCCeEEEeeccCcchhhhhhhcccCCceeeeccCCceeecccC
Confidence 3444444455445555544 5799999999888877777654 45777777643 34443 67899999987
Q ss_pred CcEEEEEEeccCCCCceEEEeeCCCceEEEeec--CCCCcEEEEeeCCcc--eEEeeccccceeEEEECCCCCEEEEEeC
Q 020784 203 DLKLLHQIETIANPKGLCAVSQGVGSLVLVCPG--LQKGQVRVEHYASKR--TKFIMAHDSRIACFALTQDGQLLATSST 278 (321)
Q Consensus 203 ~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sG--s~dg~V~i~d~~~~~--~~~l~~H~~~V~~vafspdg~~las~S~ 278 (321)
.+.....+.|.. ...+|.+-+ .+++..| +.++.+.+||..... -.+-..|.+.++++++-|..++|.|||.
T Consensus 2282 -pk~~~s~qchnk--~~~Df~Fi~--s~~~tag~s~d~~n~~lwDtl~~~~~s~v~~~H~~gaT~l~~~P~~qllisggr 2356 (2439)
T KOG1064|consen 2282 -PKPYTSWQCHNK--ALSDFRFIG--SLLATAGRSSDNRNVCLWDTLLPPMNSLVHTCHDGGATVLAYAPKHQLLISGGR 2356 (2439)
T ss_pred -CcceeccccCCc--cccceeeee--hhhhccccCCCCCcccchhcccCcccceeeeecCCCceEEEEcCcceEEEecCC
Confidence 333333344432 333333332 3344334 457799999965332 2244899999999999999999999999
Q ss_pred CCcEEEEEEcCCCcEEEEEeC
Q 020784 279 KGTLVRIFNTLDGTLLQEECC 299 (321)
Q Consensus 279 Dgt~IrIWd~~tg~~i~~~~~ 299 (321)
+|. |.|||++..++++++..
T Consensus 2357 ~G~-v~l~D~rqrql~h~~~~ 2376 (2439)
T KOG1064|consen 2357 KGE-VCLFDIRQRQLRHTFQA 2376 (2439)
T ss_pred cCc-EEEeehHHHHHHHHhhh
Confidence 999 99999999999888754
No 284
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=98.28 E-value=0.00043 Score=64.50 Aligned_cols=185 Identities=9% Similarity=0.007 Sum_probs=106.9
Q ss_pred EEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEE----EecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEe
Q 020784 99 CFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVE----MLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELS 173 (321)
Q Consensus 99 ~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~----~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~ 173 (321)
.++.+.. ..+..||.++++.+..... ........ ....++.+.+.. .++.+..+|.++|+.+.+..
T Consensus 147 ~v~v~~~~g~l~a~d~~tG~~~W~~~~--~~~~~~~~~~~sp~~~~~~v~~~~-------~~g~v~ald~~tG~~~W~~~ 217 (377)
T TIGR03300 147 LVVVRTNDGRLTALDAATGERLWTYSR--VTPALTLRGSASPVIADGGVLVGF-------AGGKLVALDLQTGQPLWEQR 217 (377)
T ss_pred EEEEECCCCeEEEEEcCCCceeeEEcc--CCCceeecCCCCCEEECCEEEEEC-------CCCEEEEEEccCCCEeeeec
Confidence 3444443 4477888888877665543 11111000 001123333333 45889999999988765443
Q ss_pred eCCc-----------e-eEEEEeCCeEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCc
Q 020784 174 FRSE-----------V-RSVKLRRDRIIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQ 240 (321)
Q Consensus 174 ~~~~-----------v-~~v~~~~~~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~ 240 (321)
.... + ....+..+.++++. ++.++.||..+++.+....... . ...... ++.+++ ++.+|.
T Consensus 218 ~~~~~g~~~~~~~~~~~~~p~~~~~~vy~~~~~g~l~a~d~~tG~~~W~~~~~~--~--~~p~~~-~~~vyv--~~~~G~ 290 (377)
T TIGR03300 218 VALPKGRTELERLVDVDGDPVVDGGQVYAVSYQGRVAALDLRSGRVLWKRDASS--Y--QGPAVD-DNRLYV--TDADGV 290 (377)
T ss_pred cccCCCCCchhhhhccCCccEEECCEEEEEEcCCEEEEEECCCCcEEEeeccCC--c--cCceEe-CCEEEE--ECCCCe
Confidence 2110 0 11223455666554 5799999999998877665321 1 111122 234444 578899
Q ss_pred EEEEeeCCcceE-Eeecc-ccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCc
Q 020784 241 VRVEHYASKRTK-FIMAH-DSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSI 302 (321)
Q Consensus 241 V~i~d~~~~~~~-~l~~H-~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~ 302 (321)
+..+|..++... ..... .....+... .+.+|..++.||. |.+||..+|+.+.++..+..
T Consensus 291 l~~~d~~tG~~~W~~~~~~~~~~ssp~i--~g~~l~~~~~~G~-l~~~d~~tG~~~~~~~~~~~ 351 (377)
T TIGR03300 291 VVALDRRSGSELWKNDELKYRQLTAPAV--VGGYLVVGDFEGY-LHWLSREDGSFVARLKTDGS 351 (377)
T ss_pred EEEEECCCCcEEEccccccCCccccCEE--ECCEEEEEeCCCE-EEEEECCCCCEEEEEEcCCC
Confidence 999888766543 22111 112222222 3668888999999 99999999999988875543
No 285
>PRK02888 nitrous-oxide reductase; Validated
Probab=98.25 E-value=0.0003 Score=68.22 Aligned_cols=214 Identities=10% Similarity=0.038 Sum_probs=127.1
Q ss_pred EcCCCCEEEEEcC-Cc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEE
Q 020784 93 FNQDHGCFAAGTD-HG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIG 170 (321)
Q Consensus 93 fs~dg~~lasg~~-~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~ 170 (321)
+.+||+.+..-+. .+ +.+.|.++.+....... ++.-..+++.+++..+.+.+-... ..+++..-|..+...+.
T Consensus 200 lpnDGk~l~~~~ey~~~vSvID~etmeV~~qV~V--dgnpd~v~~spdGk~afvTsyNsE---~G~tl~em~a~e~d~~v 274 (635)
T PRK02888 200 LPNDGKDLDDPKKYRSLFTAVDAETMEVAWQVMV--DGNLDNVDTDYDGKYAFSTCYNSE---EGVTLAEMMAAERDWVV 274 (635)
T ss_pred cCCCCCEeecccceeEEEEEEECccceEEEEEEe--CCCcccceECCCCCEEEEeccCcc---cCcceeeeccccCceEE
Confidence 4567766644443 33 44667777766555554 444556677777777766652111 12344444443333222
Q ss_pred EEeeCCceeEEEEeCCeEEEEECCEEEEEEcCC-----cEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEe
Q 020784 171 ELSFRSEVRSVKLRRDRIIVVLEQKIFVYNFAD-----LKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEH 245 (321)
Q Consensus 171 ~~~~~~~v~~v~~~~~~~~~~~~~~I~iwd~~~-----~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d 245 (321)
.+.... +..+.-..+...+ .+++|.+.|..+ .+.+..+.....+.++ .+++ |+.+++++|..+.+|.|.|
T Consensus 275 vfni~~-iea~vkdGK~~~V-~gn~V~VID~~t~~~~~~~v~~yIPVGKsPHGV-~vSP--DGkylyVanklS~tVSVID 349 (635)
T PRK02888 275 VFNIAR-IEEAVKAGKFKTI-GGSKVPVVDGRKAANAGSALTRYVPVPKNPHGV-NTSP--DGKYFIANGKLSPTVTVID 349 (635)
T ss_pred EEchHH-HHHhhhCCCEEEE-CCCEEEEEECCccccCCcceEEEEECCCCccce-EECC--CCCEEEEeCCCCCcEEEEE
Confidence 222211 0000111222333 467899999987 5677777776665543 4554 5687877899999999998
Q ss_pred eCCcce-------------EEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCC----------CcEEEEEeCCCc
Q 020784 246 YASKRT-------------KFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLD----------GTLLQEECCPSI 302 (321)
Q Consensus 246 ~~~~~~-------------~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~t----------g~~i~~~~~g~~ 302 (321)
+..... .+..- .-.....+|.++|....|---|.. |-.||+.+ ...+..+...-+
T Consensus 350 v~k~k~~~~~~~~~~~~vvaevev-GlGPLHTaFDg~G~aytslf~dsq-v~kwn~~~a~~~~~g~~~~~v~~k~dV~y~ 427 (635)
T PRK02888 350 VRKLDDLFDGKIKPRDAVVAEPEL-GLGPLHTAFDGRGNAYTTLFLDSQ-IVKWNIEAAIRAYKGEKVDPIVQKLDVHYQ 427 (635)
T ss_pred ChhhhhhhhccCCccceEEEeecc-CCCcceEEECCCCCEEEeEeecce-eEEEehHHHHHHhccccCCcceecccCCCc
Confidence 765321 11111 233567889999998888888887 88999987 345565554444
Q ss_pred ceeEEE------eecCceEEEe
Q 020784 303 SAQSGL------WLSSAWLRVL 318 (321)
Q Consensus 303 ~~~~~~------s~d~~~la~~ 318 (321)
.-.+.. .+||+||.++
T Consensus 428 pgh~~~~~g~t~~~dgk~l~~~ 449 (635)
T PRK02888 428 PGHNHASMGETKEADGKWLVSL 449 (635)
T ss_pred cceeeecCCCcCCCCCCEEEEc
Confidence 444433 5899998764
No 286
>KOG2695 consensus WD40 repeat protein [General function prediction only]
Probab=98.24 E-value=7.1e-06 Score=72.58 Aligned_cols=154 Identities=13% Similarity=0.117 Sum_probs=107.4
Q ss_pred eEEEEEcCC--CCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCC
Q 020784 88 LLHISFNQD--HGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQ 165 (321)
Q Consensus 88 V~~v~fs~d--g~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~ 165 (321)
-..|+|+-+ |-.+++|.+.+|-+-|++++-.. .|...+.|-...+...++++.... ..|.|...|++.
T Consensus 214 a~~CawSlni~gyhfs~G~sqqv~L~nvetg~~q---sf~sksDVfAlQf~~s~nLv~~Gc-------RngeI~~iDLR~ 283 (425)
T KOG2695|consen 214 AWSCAWSLNIMGYHFSVGLSQQVLLTNVETGHQQ---SFQSKSDVFALQFAGSDNLVFNGC-------RNGEIFVIDLRC 283 (425)
T ss_pred chhhhhhhccceeeecccccceeEEEEeeccccc---ccccchhHHHHHhcccCCeeEecc-------cCCcEEEEEeee
Confidence 345577653 55677888899999999887542 221245566666655566665444 469999999876
Q ss_pred C-----cEEEEEeeCCceeEEEE---eCCeEEEE-ECCEEEEEEcCCcEE---EEEEeccCCCCceEEEeeCCCceEEEe
Q 020784 166 S-----RCIGELSFRSEVRSVKL---RRDRIIVV-LEQKIFVYNFADLKL---LHQIETIANPKGLCAVSQGVGSLVLVC 233 (321)
Q Consensus 166 ~-----~~~~~~~~~~~v~~v~~---~~~~~~~~-~~~~I~iwd~~~~~~---~~~l~~~~~~~~~~~~s~~~d~~~la~ 233 (321)
+ .+...+-+++.|+++.. +...+.+. -+++|++||.+-.++ +.++++|.+...-.-+..+++..+++
T Consensus 284 rnqG~~~~a~rlyh~Ssvtslq~Lq~s~q~LmaS~M~gkikLyD~R~~K~~~~V~qYeGHvN~~a~l~~~v~~eeg~I~- 362 (425)
T KOG2695|consen 284 RNQGNGWCAQRLYHDSSVTSLQILQFSQQKLMASDMTGKIKLYDLRATKCKKSVMQYEGHVNLSAYLPAHVKEEEGSIF- 362 (425)
T ss_pred cccCCCcceEEEEcCcchhhhhhhccccceEeeccCcCceeEeeehhhhcccceeeeecccccccccccccccccceEE-
Confidence 4 35667778888888664 44444443 358999999987777 88899997766555556666655665
Q ss_pred ecCCCCcEEEEeeCCcceE
Q 020784 234 PGLQKGQVRVEHYASKRTK 252 (321)
Q Consensus 234 sGs~dg~V~i~d~~~~~~~ 252 (321)
+++.|-..+||.+..+.+.
T Consensus 363 s~GdDcytRiWsl~~ghLl 381 (425)
T KOG2695|consen 363 SVGDDCYTRIWSLDSGHLL 381 (425)
T ss_pred EccCeeEEEEEecccCcee
Confidence 4888999999998876644
No 287
>COG4946 Uncharacterized protein related to the periplasmic component of the Tol biopolymer transport system [Function unknown]
Probab=98.23 E-value=0.00029 Score=65.06 Aligned_cols=170 Identities=12% Similarity=0.056 Sum_probs=113.0
Q ss_pred EcC-CCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCC-cEEEEeCCCCcEEE
Q 020784 93 FNQ-DHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLN-KVMIWDDHQSRCIG 170 (321)
Q Consensus 93 fs~-dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~-~v~iWD~~~~~~~~ 170 (321)
|+. +|.++|.-+.+.+.|.+...+-. ....+.+.|....+.-+++.++++. .|+ .+-|+|.++++...
T Consensus 327 fa~~~Gd~ia~VSRGkaFi~~~~~~~~---iqv~~~~~VrY~r~~~~~e~~vigt-------~dgD~l~iyd~~~~e~kr 396 (668)
T COG4946 327 FAVVNGDYIALVSRGKAFIMRPWDGYS---IQVGKKGGVRYRRIQVDPEGDVIGT-------NDGDKLGIYDKDGGEVKR 396 (668)
T ss_pred hccCCCcEEEEEecCcEEEECCCCCee---EEcCCCCceEEEEEccCCcceEEec-------cCCceEEEEecCCceEEE
Confidence 443 68999988887765655433322 1221456687777777777666665 455 89999999887655
Q ss_pred EEeeCCceeEEEEeCCe-EEEEE-CC-EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCC----cEEE
Q 020784 171 ELSFRSEVRSVKLRRDR-IIVVL-EQ-KIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKG----QVRV 243 (321)
Q Consensus 171 ~~~~~~~v~~v~~~~~~-~~~~~-~~-~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg----~V~i 243 (321)
....-+.|.++..+++. .+++. +. .|-++|+.+++.. +........+..|..+++..++|+ +.-+| .|++
T Consensus 397 ~e~~lg~I~av~vs~dGK~~vvaNdr~el~vididngnv~--~idkS~~~lItdf~~~~nsr~iAY-afP~gy~tq~Ikl 473 (668)
T COG4946 397 IEKDLGNIEAVKVSPDGKKVVVANDRFELWVIDIDNGNVR--LIDKSEYGLITDFDWHPNSRWIAY-AFPEGYYTQSIKL 473 (668)
T ss_pred eeCCccceEEEEEcCCCcEEEEEcCceEEEEEEecCCCee--EecccccceeEEEEEcCCceeEEE-ecCcceeeeeEEE
Confidence 44445688899998874 34444 43 7777788887652 222334456778888888899998 55555 6788
Q ss_pred EeeCCcceEEeeccccceeEEEECCCCCEEEE
Q 020784 244 EHYASKRTKFIMAHDSRIACFALTQDGQLLAT 275 (321)
Q Consensus 244 ~d~~~~~~~~l~~H~~~V~~vafspdg~~las 275 (321)
+|+.++.+....--.+.=.+=||.|||++|-=
T Consensus 474 ydm~~~Kiy~vTT~ta~DfsPaFD~d~ryLYf 505 (668)
T COG4946 474 YDMDGGKIYDVTTPTAYDFSPAFDPDGRYLYF 505 (668)
T ss_pred EecCCCeEEEecCCcccccCcccCCCCcEEEE
Confidence 99888765544434444456789999987644
No 288
>KOG0309 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=98.22 E-value=8.3e-06 Score=78.54 Aligned_cols=198 Identities=15% Similarity=0.148 Sum_probs=120.2
Q ss_pred CCCCCCeEEEEEcCCC-CEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEec-CCCeEEEEeCCCCCCCCCCcE
Q 020784 82 SSPPPTLLHISFNQDH-GCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLF-RCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg-~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~-~~~~~~~~sg~~~~~~~d~~v 158 (321)
++|...|+.+.|++.. ..||+++-+. +..||+.....-+.........-..|+|.. +++.++. + ..+.|
T Consensus 111 hghsraitd~n~~~q~pdVlatcsvdt~vh~wd~rSp~~p~ys~~~w~s~asqVkwnyk~p~vlas-s-------hg~~i 182 (1081)
T KOG0309|consen 111 HGHSRAITDINFNPQHPDVLATCSVDTYVHAWDMRSPHRPFYSTSSWRSAASQVKWNYKDPNVLAS-S-------HGNDI 182 (1081)
T ss_pred ecCccceeccccCCCCCcceeeccccccceeeeccCCCcceeeeecccccCceeeecccCcchhhh-c-------cCCce
Confidence 6788899999999876 5788888877 669999765433221111123345566654 4444443 3 34779
Q ss_pred EEEeCCCCc-EEEEEeeCC-ceeEEEEeCC---e-EEEEECCEEEEEEcCCc--EEEEEEeccCCCCceEEEeeCCCceE
Q 020784 159 MIWDDHQSR-CIGELSFRS-EVRSVKLRRD---R-IIVVLEQKIFVYNFADL--KLLHQIETIANPKGLCAVSQGVGSLV 230 (321)
Q Consensus 159 ~iWD~~~~~-~~~~~~~~~-~v~~v~~~~~---~-~~~~~~~~I~iwd~~~~--~~~~~l~~~~~~~~~~~~s~~~d~~~ 230 (321)
++||.+.|. .+..++.+. .|..++|+.. . +....+++|++||..+- +..+++.+ ..++-.-++-|-+++.+
T Consensus 183 ~vwd~r~gs~pl~s~K~~vs~vn~~~fnr~~~s~~~s~~~d~tvkfw~y~kSt~e~~~~vtt-~~piw~~r~~Pfg~g~~ 261 (1081)
T KOG0309|consen 183 FVWDLRKGSTPLCSLKGHVSSVNSIDFNRFKYSEIMSSSNDGTVKFWDYSKSTTESKRTVTT-NFPIWRGRYLPFGEGYC 261 (1081)
T ss_pred EEEeccCCCcceEEecccceeeehHHHhhhhhhhhcccCCCCceeeecccccccccceeccc-cCcceeccccccCceeE
Confidence 999998775 455555532 4666677653 2 23345689999998542 22222222 22333344555555544
Q ss_pred EEeecCCCCcEEEEe---------eC--CcceEEeeccccceeEEEECC--------C--CCEEEEEeCCCcEEEEEEcC
Q 020784 231 LVCPGLQKGQVRVEH---------YA--SKRTKFIMAHDSRIACFALTQ--------D--GQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 231 la~sGs~dg~V~i~d---------~~--~~~~~~l~~H~~~V~~vafsp--------d--g~~las~S~Dgt~IrIWd~~ 289 (321)
+.- --.+.+|.+.+ .. ..++++|.||+..|...-|-- | .-.|+|=|.|.+ +|+|-+.
T Consensus 262 ~mp-~~G~n~v~~~~c~n~d~e~n~~~~~~pVh~F~GH~D~V~eFlWR~r~e~~~d~d~rdfQLVTWSkD~~-lrlWpI~ 339 (1081)
T KOG0309|consen 262 IMP-MVGGNMVPQLRCENSDLEWNVFDLNTPVHTFVGHDDVVLEFLWRKRKECDGDYDSRDFQLVTWSKDQT-LRLWPID 339 (1081)
T ss_pred ecc-ccCCeeeeeccccchhhhhccccCCcceeeecCcchHHHHHhhhhcccccCCCCccceeEEEeecCCc-eEeeecc
Confidence 432 12222444332 21 235789999999886655532 2 236999999999 9999887
Q ss_pred C
Q 020784 290 D 290 (321)
Q Consensus 290 t 290 (321)
+
T Consensus 340 ~ 340 (1081)
T KOG0309|consen 340 S 340 (1081)
T ss_pred H
Confidence 5
No 289
>KOG1275 consensus PAB-dependent poly(A) ribonuclease, subunit PAN2 [Replication, recombination and repair]
Probab=98.13 E-value=8.1e-05 Score=73.45 Aligned_cols=177 Identities=15% Similarity=0.239 Sum_probs=121.4
Q ss_pred CCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeC
Q 020784 97 HGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFR 175 (321)
Q Consensus 97 g~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~ 175 (321)
+..+..|+- +.+..+|+.+.++...... ..+++..+ ..+++.+.++. ..|+|.+=|.++.+.++++..+
T Consensus 147 ~~~~i~Gg~Q~~li~~Dl~~~~e~r~~~v-~a~~v~im--R~Nnr~lf~G~-------t~G~V~LrD~~s~~~iht~~aH 216 (1118)
T KOG1275|consen 147 PSTLIMGGLQEKLIHIDLNTEKETRTTNV-SASGVTIM--RYNNRNLFCGD-------TRGTVFLRDPNSFETIHTFDAH 216 (1118)
T ss_pred Ccceeecchhhheeeeecccceeeeeeec-cCCceEEE--EecCcEEEeec-------ccceEEeecCCcCceeeeeecc
Confidence 444555544 5577888888776555544 12234433 33444444433 4699999999999999999866
Q ss_pred C-ceeEEEEeCCeEEEEE----------CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEE
Q 020784 176 S-EVRSVKLRRDRIIVVL----------EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVE 244 (321)
Q Consensus 176 ~-~v~~v~~~~~~~~~~~----------~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~ 244 (321)
. .+..+..+.+.++.|+ |.-|++||++.++.+.-+..+..+ ..+.|.|.-...+.+ .+..|.+.+-
T Consensus 217 s~siSDfDv~GNlLitCG~S~R~~~l~~D~FvkVYDLRmmral~PI~~~~~P-~flrf~Psl~t~~~V--~S~sGq~q~v 293 (1118)
T KOG1275|consen 217 SGSISDFDVQGNLLITCGYSMRRYNLAMDPFVKVYDLRMMRALSPIQFPYGP-QFLRFHPSLTTRLAV--TSQSGQFQFV 293 (1118)
T ss_pred ccceeeeeccCCeEEEeecccccccccccchhhhhhhhhhhccCCcccccCc-hhhhhcccccceEEE--Eecccceeec
Confidence 5 7888999988888774 346999999998887766655444 244555554434444 4667888886
Q ss_pred e---eCCcce--EEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEE
Q 020784 245 H---YASKRT--KFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 245 d---~~~~~~--~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd 287 (321)
| +.+-.. ..+..-.+.+..+++|++|..||-|-.+|. |.+|.
T Consensus 294 d~~~lsNP~~~~~~v~p~~s~i~~fDiSsn~~alafgd~~g~-v~~wa 340 (1118)
T KOG1275|consen 294 DTATLSNPPAGVKMVNPNGSGISAFDISSNGDALAFGDHEGH-VNLWA 340 (1118)
T ss_pred cccccCCCccceeEEccCCCcceeEEecCCCceEEEecccCc-Eeeec
Confidence 6 333322 233344566999999999999999999999 99997
No 290
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=98.11 E-value=0.0047 Score=53.19 Aligned_cols=198 Identities=15% Similarity=0.123 Sum_probs=111.8
Q ss_pred cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeE-EEEeC
Q 020784 107 GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRS-VKLRR 185 (321)
Q Consensus 107 gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~-v~~~~ 185 (321)
.+..||..+++.+....+.....-........++.+.+.+ .++.|..||..+|+.+..+.....+.. .....
T Consensus 4 ~l~~~d~~tG~~~W~~~~~~~~~~~~~~~~~~~~~v~~~~-------~~~~l~~~d~~tG~~~W~~~~~~~~~~~~~~~~ 76 (238)
T PF13360_consen 4 TLSALDPRTGKELWSYDLGPGIGGPVATAVPDGGRVYVAS-------GDGNLYALDAKTGKVLWRFDLPGPISGAPVVDG 76 (238)
T ss_dssp EEEEEETTTTEEEEEEECSSSCSSEEETEEEETTEEEEEE-------TTSEEEEEETTTSEEEEEEECSSCGGSGEEEET
T ss_pred EEEEEECCCCCEEEEEECCCCCCCccceEEEeCCEEEEEc-------CCCEEEEEECCCCCEEEEeeccccccceeeecc
Confidence 3557777777766666541001111111223455565655 469999999999999888887654332 35566
Q ss_pred CeEEEEE-CCEEEEEEcCCcEEEEEE-eccCCCC---ceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceE-Eeecccc
Q 020784 186 DRIIVVL-EQKIFVYNFADLKLLHQI-ETIANPK---GLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTK-FIMAHDS 259 (321)
Q Consensus 186 ~~~~~~~-~~~I~iwd~~~~~~~~~l-~~~~~~~---~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~-~l~~H~~ 259 (321)
+.++++. ++.|+.+|..+++.+.++ ....... ........+ +.+++ +..+|.|...|..++.+. ....+..
T Consensus 77 ~~v~v~~~~~~l~~~d~~tG~~~W~~~~~~~~~~~~~~~~~~~~~~-~~~~~--~~~~g~l~~~d~~tG~~~w~~~~~~~ 153 (238)
T PF13360_consen 77 GRVYVGTSDGSLYALDAKTGKVLWSIYLTSSPPAGVRSSSSPAVDG-DRLYV--GTSSGKLVALDPKTGKLLWKYPVGEP 153 (238)
T ss_dssp TEEEEEETTSEEEEEETTTSCEEEEEEE-SSCTCSTB--SEEEEET-TEEEE--EETCSEEEEEETTTTEEEEEEESSTT
T ss_pred cccccccceeeeEecccCCcceeeeeccccccccccccccCceEec-CEEEE--EeccCcEEEEecCCCcEEEEeecCCC
Confidence 7777776 569999999999998885 4332111 122233332 23443 455788988888776643 3333321
Q ss_pred c----------eeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEe
Q 020784 260 R----------IACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 260 ~----------V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~ 318 (321)
. +..-....++ .+..++.++..+.+ |+.+|+.+-+.. ..........++..|.+.
T Consensus 154 ~~~~~~~~~~~~~~~~~~~~~-~v~~~~~~g~~~~~-d~~tg~~~w~~~--~~~~~~~~~~~~~~l~~~ 218 (238)
T PF13360_consen 154 RGSSPISSFSDINGSPVISDG-RVYVSSGDGRVVAV-DLATGEKLWSKP--ISGIYSLPSVDGGTLYVT 218 (238)
T ss_dssp -SS--EEEETTEEEEEECCTT-EEEEECCTSSEEEE-ETTTTEEEEEEC--SS-ECECEECCCTEEEEE
T ss_pred CCCcceeeecccccceEEECC-EEEEEcCCCeEEEE-ECCCCCEEEEec--CCCccCCceeeCCEEEEE
Confidence 1 1232333355 55556667754666 999999664332 111222245555555443
No 291
>PF00780 CNH: CNH domain; InterPro: IPR001180 Based on sequence similarities a domain of homology has been identified in the following proteins []: Citron and Citron kinase. These two proteins interact with the GTP-bound forms of the small GTPases Rho and Rac but not with Cdc42. Myotonic dystrophy kinase-related Cdc42-binding kinase (MRCKalpha). This serine/threonine kinase interacts with the GTP-bound form of the small GTPase Cdc42 and to a lesser extent with that of Rac. NCK Interacting Kinase (NIK), a serine/threonine protein kinase. ROM-1 and ROM-2, from yeast. These proteins are GDP/GTP exchange proteins (GEPs) for the small GTP binding protein Rho1. This domain, called the citron homology domain, is often found after cysteine rich and pleckstrin homology (PH) domains at the C-terminal end of the proteins []. It acts as a regulatory domain and could be involved in macromolecular interactions [, ].; GO: 0005083 small GTPase regulator activity
Probab=98.11 E-value=0.0027 Score=56.37 Aligned_cols=197 Identities=12% Similarity=0.156 Sum_probs=120.0
Q ss_pred CeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEe-------------eeecCCceEEEE--EecCCCeEEEEeCCCCC
Q 020784 87 TLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRR-------------DFERGGGIGVVE--MLFRCNILALVGGGPDP 151 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~-------------~~~~~~~v~~v~--~~~~~~~~~~~sg~~~~ 151 (321)
.|..+..-++-+.|++=+++.+.+++++........ ......++...+ -...+....++.
T Consensus 37 ~I~ql~vl~~~~~llvLsd~~l~~~~L~~l~~~~~~~~~~~~~~~~~~~~~~~~~~v~~f~~~~~~~~~~~L~va----- 111 (275)
T PF00780_consen 37 SITQLSVLPELNLLLVLSDGQLYVYDLDSLEPVSTSAPLAFPKSRSLPTKLPETKGVSFFAVNGGHEGSRRLCVA----- 111 (275)
T ss_pred eEEEEEEecccCEEEEEcCCccEEEEchhhccccccccccccccccccccccccCCeeEEeeccccccceEEEEE-----
Confidence 499999999888888777888899998655433210 110122333333 122233333333
Q ss_pred CCCCCcEEEEeCCC----C-cEEEEEeeCCceeEEEEeCCeEEEEECCEEEEEEcCCcEEEEEEeccCCC----------
Q 020784 152 QYPLNKVMIWDDHQ----S-RCIGELSFRSEVRSVKLRRDRIIVVLEQKIFVYNFADLKLLHQIETIANP---------- 216 (321)
Q Consensus 152 ~~~d~~v~iWD~~~----~-~~~~~~~~~~~v~~v~~~~~~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~---------- 216 (321)
..++|.||.... . +...++.....+..++|.++.++++..+...+.|+.++....-+......
T Consensus 112 --~kk~i~i~~~~~~~~~f~~~~ke~~lp~~~~~i~~~~~~i~v~~~~~f~~idl~~~~~~~l~~~~~~~~~~~~~~~~~ 189 (275)
T PF00780_consen 112 --VKKKILIYEWNDPRNSFSKLLKEISLPDPPSSIAFLGNKICVGTSKGFYLIDLNTGSPSELLDPSDSSSSFKSRNSSS 189 (275)
T ss_pred --ECCEEEEEEEECCcccccceeEEEEcCCCcEEEEEeCCEEEEEeCCceEEEecCCCCceEEeCccCCcchhhhcccCC
Confidence 347899888754 2 56778888999999999999999999999999999876554333221111
Q ss_pred CceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceE-EeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEE
Q 020784 217 KGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTK-FIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQ 295 (321)
Q Consensus 217 ~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~-~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~ 295 (321)
.....+..+ ++.+|++ . |..-...+....... ..-.-...+.++++. ..+|...+ ++. |-||++.+|++++
T Consensus 190 ~~~~~~~~~-~~e~Ll~--~-~~~g~fv~~~G~~~r~~~i~W~~~p~~~~~~--~pyli~~~-~~~-iEV~~~~~~~lvQ 261 (275)
T PF00780_consen 190 KPLGIFQLS-DNEFLLC--Y-DNIGVFVNKNGEPSRKSTIQWSSAPQSVAYS--SPYLIAFS-SNS-IEVRSLETGELVQ 261 (275)
T ss_pred CceEEEEeC-CceEEEE--e-cceEEEEcCCCCcCcccEEEcCCchhEEEEE--CCEEEEEC-CCE-EEEEECcCCcEEE
Confidence 112222222 3355553 2 222222343333322 111224467788884 45777665 566 9999999999999
Q ss_pred EEe
Q 020784 296 EEC 298 (321)
Q Consensus 296 ~~~ 298 (321)
++.
T Consensus 262 ~i~ 264 (275)
T PF00780_consen 262 TIP 264 (275)
T ss_pred EEE
Confidence 985
No 292
>PF06433 Me-amine-dh_H: Methylamine dehydrogenase heavy chain (MADH); InterPro: IPR009451 Methylamine dehydrogenase (1.4.99.3 from EC) is a periplasmic quinoprotein found in several methyltrophic bacteria []. It is induced when grown on methylamine as a carbon source MADH and catalyses the oxidative deamination of amines to their corresponding aldehydes. The redox cofactor of this enzyme is tryptophan tryptophylquinone (TTQ). Electrons derived from the oxidation of methylamine are passed to an electron acceptor, which is usually the blue-copper protein amicyanin (IPR002386 from INTERPRO). RCH2NH2 + H2O + acceptor = RCHO + NH3 + reduced acceptor MADH is a hetero-tetramer, comprised of two heavy subunits and two light subunits. The heavy subunit forms a seven-bladed beta-propeller like structure [].; GO: 0030058 amine dehydrogenase activity, 0030416 methylamine metabolic process, 0055114 oxidation-reduction process, 0042597 periplasmic space; PDB: 3RN1_F 3SVW_F 3PXT_F 3L4O_F 3L4M_D 3SJL_F 3PXS_D 3ORV_F 3RMZ_F 3RLM_F ....
Probab=98.09 E-value=0.0072 Score=54.64 Aligned_cols=211 Identities=14% Similarity=0.167 Sum_probs=104.8
Q ss_pred EEEEcCCCCEEEEEc---------C--CcEEEEEecCCceeEEeeeecCC-ce------EEEEEecCCCeEEEEeCCCCC
Q 020784 90 HISFNQDHGCFAAGT---------D--HGFRIYNCDPFREIFRRDFERGG-GI------GVVEMLFRCNILALVGGGPDP 151 (321)
Q Consensus 90 ~v~fs~dg~~lasg~---------~--~gv~vw~~~~~~~~~~~~~~~~~-~v------~~v~~~~~~~~~~~~sg~~~~ 151 (321)
.+..+|||+.+++.. + |-|.+||.++.......... .+ .. ....++.+++.+.+..-.
T Consensus 40 ~~~~spdgk~~y~a~T~~sR~~rG~RtDvv~~~D~~TL~~~~EI~iP-~k~R~~~~~~~~~~~ls~dgk~~~V~N~T--- 115 (342)
T PF06433_consen 40 NVALSPDGKTIYVAETFYSRGTRGERTDVVEIWDTQTLSPTGEIEIP-PKPRAQVVPYKNMFALSADGKFLYVQNFT--- 115 (342)
T ss_dssp EEEE-TTSSEEEEEEEEEEETTEEEEEEEEEEEETTTTEEEEEEEET-TS-B--BS--GGGEEE-TTSSEEEEEEES---
T ss_pred ceeECCCCCEEEEEEEEEeccccccceeEEEEEecCcCcccceEecC-CcchheecccccceEEccCCcEEEEEccC---
Confidence 466899999888654 1 23569999998766555541 11 11 122334444444443311
Q ss_pred CCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCe-EEEEECCEEEEEEcC-CcEEEEEEecc----CCCC--------
Q 020784 152 QYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDR-IIVVLEQKIFVYNFA-DLKLLHQIETI----ANPK-------- 217 (321)
Q Consensus 152 ~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~-~~~~~~~~I~iwd~~-~~~~~~~l~~~----~~~~-------- 217 (321)
--..|-|-|+..++.+.++...+...-.-..++. ..+|.|+.+--..+. .|+..++-... ..+.
T Consensus 116 --Pa~SVtVVDl~~~kvv~ei~~PGC~~iyP~~~~~F~~lC~DGsl~~v~Ld~~Gk~~~~~t~~F~~~~dp~f~~~~~~~ 193 (342)
T PF06433_consen 116 --PATSVTVVDLAAKKVVGEIDTPGCWLIYPSGNRGFSMLCGDGSLLTVTLDADGKEAQKSTKVFDPDDDPLFEHPAYSR 193 (342)
T ss_dssp --SSEEEEEEETTTTEEEEEEEGTSEEEEEEEETTEEEEEETTSCEEEEEETSTSSEEEEEEEESSTTTS-B-S--EEET
T ss_pred --CCCeEEEEECCCCceeeeecCCCEEEEEecCCCceEEEecCCceEEEEECCCCCEeEeeccccCCCCcccccccceEC
Confidence 2255888889999988888877644333344343 344556666666664 34333221110 0000
Q ss_pred -----------------------------------------------ceEEEeeCCCceEEEee-c----CCCCcEEE--
Q 020784 218 -----------------------------------------------GLCAVSQGVGSLVLVCP-G----LQKGQVRV-- 243 (321)
Q Consensus 218 -----------------------------------------------~~~~~s~~~d~~~la~s-G----s~dg~V~i-- 243 (321)
..++++...+..++..- | ..|+--.|
T Consensus 194 ~~~~~~F~Sy~G~v~~~dlsg~~~~~~~~~~~~t~~e~~~~WrPGG~Q~~A~~~~~~rlyvLMh~g~~gsHKdpgteVWv 273 (342)
T PF06433_consen 194 DGGRLYFVSYEGNVYSADLSGDSAKFGKPWSLLTDAEKADGWRPGGWQLIAYHAASGRLYVLMHQGGEGSHKDPGTEVWV 273 (342)
T ss_dssp TTTEEEEEBTTSEEEEEEETTSSEEEEEEEESS-HHHHHTTEEE-SSS-EEEETTTTEEEEEEEE--TT-TTS-EEEEEE
T ss_pred CCCeEEEEecCCEEEEEeccCCcccccCcccccCccccccCcCCcceeeeeeccccCeEEEEecCCCCCCccCCceEEEE
Confidence 01222221111111110 0 11332233
Q ss_pred EeeCCcc-eEEeeccccceeEEEECCCCC-EEEEEe-CCCcEEEEEEcCCCcEEEEEeCCCcceeEEE
Q 020784 244 EHYASKR-TKFIMAHDSRIACFALTQDGQ-LLATSS-TKGTLVRIFNTLDGTLLQEECCPSISAQSGL 308 (321)
Q Consensus 244 ~d~~~~~-~~~l~~H~~~V~~vafspdg~-~las~S-~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~ 308 (321)
+|..+++ +..+.. ..++.+|+.+.+.+ +|.+.+ .++. +.|||..+|+++++++.-.....+.+
T Consensus 274 ~D~~t~krv~Ri~l-~~~~~Si~Vsqd~~P~L~~~~~~~~~-l~v~D~~tGk~~~~~~~lG~~~~l~~ 339 (342)
T PF06433_consen 274 YDLKTHKRVARIPL-EHPIDSIAVSQDDKPLLYALSAGDGT-LDVYDAATGKLVRSIEQLGETPTLIL 339 (342)
T ss_dssp EETTTTEEEEEEEE-EEEESEEEEESSSS-EEEEEETTTTE-EEEEETTT--EEEEE---SSS--EEE
T ss_pred EECCCCeEEEEEeC-CCccceEEEccCCCcEEEEEcCCCCe-EEEEeCcCCcEEeehhccCCCceEEE
Confidence 3444443 223321 34578999997754 665544 5788 99999999999999975444444433
No 293
>KOG2114 consensus Vacuolar assembly/sorting protein PEP5/VPS11 [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.08 E-value=0.0014 Score=64.58 Aligned_cols=221 Identities=15% Similarity=0.157 Sum_probs=125.2
Q ss_pred CeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCc-eEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC
Q 020784 87 TLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGG-IGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH 164 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~-v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~ 164 (321)
.|.| |++.+..+|.|+.+| |.+.+-. .+....... +... +..+......+.+++++.+..+ +.-.|+|||++
T Consensus 27 ~isc--~~s~~~~vvigt~~G~V~~Ln~s-~~~~~~fqa-~~~siv~~L~~~~~~~~L~sv~Ed~~~--np~llkiw~le 100 (933)
T KOG2114|consen 27 AISC--CSSSTGSVVIGTADGRVVILNSS-FQLIRGFQA-YEQSIVQFLYILNKQNFLFSVGEDEQG--NPVLLKIWDLE 100 (933)
T ss_pred ceeE--EcCCCceEEEeeccccEEEeccc-ceeeehhee-cchhhhhHhhcccCceEEEEEeecCCC--CceEEEEeccc
Confidence 4554 578888899999877 4454421 222122221 2333 4444444455666666644321 23379999975
Q ss_pred CC------cEEEE---Ee--e---CCceeEEEEeCCe--EEEE-ECCEEEEEEc---CCcEEEEEE-eccCCCCceEEEe
Q 020784 165 QS------RCIGE---LS--F---RSEVRSVKLRRDR--IIVV-LEQKIFVYNF---ADLKLLHQI-ETIANPKGLCAVS 223 (321)
Q Consensus 165 ~~------~~~~~---~~--~---~~~v~~v~~~~~~--~~~~-~~~~I~iwd~---~~~~~~~~l-~~~~~~~~~~~~s 223 (321)
.- +++.+ +. . ..++..+.++.+. ++++ ++|.|..+.- +.......+ .....++.-.++.
T Consensus 101 k~~~n~sP~c~~~~ri~~~~np~~~~p~s~l~Vs~~l~~Iv~Gf~nG~V~~~~GDi~RDrgsr~~~~~~~~~pITgL~~~ 180 (933)
T KOG2114|consen 101 KVDKNNSPQCLYEHRIFTIKNPTNPSPASSLAVSEDLKTIVCGFTNGLVICYKGDILRDRGSRQDYSHRGKEPITGLALR 180 (933)
T ss_pred ccCCCCCcceeeeeeeeccCCCCCCCcceEEEEEccccEEEEEecCcEEEEEcCcchhccccceeeeccCCCCceeeEEe
Confidence 42 34422 22 1 2346667777654 3333 3578888853 211111111 1223445555555
Q ss_pred eCCCceEEEeecCCCCcEEEEeeCCcc--eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCC
Q 020784 224 QGVGSLVLVCPGLQKGQVRVEHYASKR--TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPS 301 (321)
Q Consensus 224 ~~~d~~~la~sGs~dg~V~i~d~~~~~--~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~ 301 (321)
.++...++|+ . -..|.++.+..+. ..++..|...++|.+|++....|+.|+.. .+.+++....+..-+|..|+
T Consensus 181 ~d~~s~lFv~--T-t~~V~~y~l~gr~p~~~~ld~~G~~lnCss~~~~t~qfIca~~e--~l~fY~sd~~~~cfaf~~g~ 255 (933)
T KOG2114|consen 181 SDGKSVLFVA--T-TEQVMLYSLSGRTPSLKVLDNNGISLNCSSFSDGTYQFICAGSE--FLYFYDSDGRGPCFAFEVGE 255 (933)
T ss_pred cCCceeEEEE--e-cceeEEEEecCCCcceeeeccCCccceeeecCCCCccEEEecCc--eEEEEcCCCcceeeeecCCC
Confidence 5554333443 2 2368888877665 45688899999999999765545555533 38999998777777887666
Q ss_pred cceeEEEeecCceEEEee
Q 020784 302 ISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 302 ~~~~~~~s~d~~~la~~~ 319 (321)
... +.++..|.+|.|.+
T Consensus 256 kk~-~~~~~~g~~L~v~~ 272 (933)
T KOG2114|consen 256 KKE-MLVFSFGLLLCVTT 272 (933)
T ss_pred eEE-EEEEecCEEEEEEc
Confidence 632 23333377777754
No 294
>PF08450 SGL: SMP-30/Gluconolaconase/LRE-like region; InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=98.07 E-value=0.0062 Score=53.12 Aligned_cols=212 Identities=13% Similarity=0.075 Sum_probs=121.5
Q ss_pred EEEEcC-CCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCc
Q 020784 90 HISFNQ-DHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSR 167 (321)
Q Consensus 90 ~v~fs~-dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~ 167 (321)
++.|.+ +|.++.+....+ |..|+.++..... ... .+ ...+.+......++++. .+.+.++|..+++
T Consensus 4 gp~~d~~~g~l~~~D~~~~~i~~~~~~~~~~~~-~~~--~~-~~G~~~~~~~g~l~v~~--------~~~~~~~d~~~g~ 71 (246)
T PF08450_consen 4 GPVWDPRDGRLYWVDIPGGRIYRVDPDTGEVEV-IDL--PG-PNGMAFDRPDGRLYVAD--------SGGIAVVDPDTGK 71 (246)
T ss_dssp EEEEETTTTEEEEEETTTTEEEEEETTTTEEEE-EES--SS-EEEEEEECTTSEEEEEE--------TTCEEEEETTTTE
T ss_pred ceEEECCCCEEEEEEcCCCEEEEEECCCCeEEE-Eec--CC-CceEEEEccCCEEEEEE--------cCceEEEecCCCc
Confidence 578888 777777766544 6677877765533 222 33 33444442334454444 2557777999887
Q ss_pred EEEEEee--C----CceeEEEEeCCe-EEEEEC----------CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceE
Q 020784 168 CIGELSF--R----SEVRSVKLRRDR-IIVVLE----------QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLV 230 (321)
Q Consensus 168 ~~~~~~~--~----~~v~~v~~~~~~-~~~~~~----------~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~ 230 (321)
....+.. . ..+..+.+.++. +++... +.|..++.. ++.......- ..-.-+++++ |+..
T Consensus 72 ~~~~~~~~~~~~~~~~~ND~~vd~~G~ly~t~~~~~~~~~~~~g~v~~~~~~-~~~~~~~~~~-~~pNGi~~s~--dg~~ 147 (246)
T PF08450_consen 72 VTVLADLPDGGVPFNRPNDVAVDPDGNLYVTDSGGGGASGIDPGSVYRIDPD-GKVTVVADGL-GFPNGIAFSP--DGKT 147 (246)
T ss_dssp EEEEEEEETTCSCTEEEEEEEE-TTS-EEEEEECCBCTTCGGSEEEEEEETT-SEEEEEEEEE-SSEEEEEEET--TSSE
T ss_pred EEEEeeccCCCcccCCCceEEEcCCCCEEEEecCCCccccccccceEEECCC-CeEEEEecCc-ccccceEECC--cchh
Confidence 6544443 1 246678888775 444432 235566666 4543333322 2222345555 4454
Q ss_pred EEeecCCCCcEEEEeeCC--cce---EEe---eccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCc
Q 020784 231 LVCPGLQKGQVRVEHYAS--KRT---KFI---MAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSI 302 (321)
Q Consensus 231 la~sGs~dg~V~i~d~~~--~~~---~~l---~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~ 302 (321)
|.++-+..+.|..+++.. ..+ ..+ ..-.+..-.+++..+|++.++.-..+. |.++|-. |+++..+.....
T Consensus 148 lyv~ds~~~~i~~~~~~~~~~~~~~~~~~~~~~~~~g~pDG~~vD~~G~l~va~~~~~~-I~~~~p~-G~~~~~i~~p~~ 225 (246)
T PF08450_consen 148 LYVADSFNGRIWRFDLDADGGELSNRRVFIDFPGGPGYPDGLAVDSDGNLWVADWGGGR-IVVFDPD-GKLLREIELPVP 225 (246)
T ss_dssp EEEEETTTTEEEEEEEETTTCCEEEEEEEEE-SSSSCEEEEEEEBTTS-EEEEEETTTE-EEEEETT-SCEEEEEE-SSS
T ss_pred eeecccccceeEEEeccccccceeeeeeEEEcCCCCcCCCcceEcCCCCEEEEEcCCCE-EEEECCC-ccEEEEEcCCCC
Confidence 444467777877777642 212 122 222234889999999998887766777 9999987 999998877633
Q ss_pred -ceeEEEe-ecCceEEEee
Q 020784 303 -SAQSGLW-LSSAWLRVLR 319 (321)
Q Consensus 303 -~~~~~~s-~d~~~la~~~ 319 (321)
....+|. .+...|-+.+
T Consensus 226 ~~t~~~fgg~~~~~L~vTt 244 (246)
T PF08450_consen 226 RPTNCAFGGPDGKTLYVTT 244 (246)
T ss_dssp SEEEEEEESTTSSEEEEEE
T ss_pred CEEEEEEECCCCCEEEEEe
Confidence 2333442 4556665543
No 295
>KOG2695 consensus WD40 repeat protein [General function prediction only]
Probab=98.06 E-value=2.4e-05 Score=69.30 Aligned_cols=153 Identities=13% Similarity=0.118 Sum_probs=94.8
Q ss_pred CcEEEEeCCCCcEEEEEeeCCceeEEEEeC-CeEEEEE--CCEEEEEEcCCc-----EEEEEEeccCCCCceEEEeeCCC
Q 020784 156 NKVMIWDDHQSRCIGELSFRSEVRSVKLRR-DRIIVVL--EQKIFVYNFADL-----KLLHQIETIANPKGLCAVSQGVG 227 (321)
Q Consensus 156 ~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~-~~~~~~~--~~~I~iwd~~~~-----~~~~~l~~~~~~~~~~~~s~~~d 227 (321)
..|-+-|+++|... .|...+.|.++.|+. +-++.++ .+.|..+|++.. ...+.|-.. ..+.++-+-.. +
T Consensus 234 qqv~L~nvetg~~q-sf~sksDVfAlQf~~s~nLv~~GcRngeI~~iDLR~rnqG~~~~a~rlyh~-Ssvtslq~Lq~-s 310 (425)
T KOG2695|consen 234 QQVLLTNVETGHQQ-SFQSKSDVFALQFAGSDNLVFNGCRNGEIFVIDLRCRNQGNGWCAQRLYHD-SSVTSLQILQF-S 310 (425)
T ss_pred ceeEEEEeeccccc-ccccchhHHHHHhcccCCeeEecccCCcEEEEEeeecccCCCcceEEEEcC-cchhhhhhhcc-c
Confidence 55666676665432 344455788888876 3344443 479999999643 333343322 22222211111 2
Q ss_pred ceEEEeecCCCCcEEEEeeCC-cc---eEEeeccccceeEEEE--CCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCC
Q 020784 228 SLVLVCPGLQKGQVRVEHYAS-KR---TKFIMAHDSRIACFAL--TQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPS 301 (321)
Q Consensus 228 ~~~la~sGs~dg~V~i~d~~~-~~---~~~l~~H~~~V~~vaf--spdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~ 301 (321)
.+.|.+ .+.+|+|++||... +. +.++.+|.+.-.-+-+ .+....++++++|.. .|||.+.+|.++.+.....
T Consensus 311 ~q~Lma-S~M~gkikLyD~R~~K~~~~V~qYeGHvN~~a~l~~~v~~eeg~I~s~GdDcy-tRiWsl~~ghLl~tipf~~ 388 (425)
T KOG2695|consen 311 QQKLMA-SDMTGKIKLYDLRATKCKKSVMQYEGHVNLSAYLPAHVKEEEGSIFSVGDDCY-TRIWSLDSGHLLCTIPFPY 388 (425)
T ss_pred cceEee-ccCcCceeEeeehhhhcccceeeeecccccccccccccccccceEEEccCeeE-EEEEecccCceeeccCCCC
Confidence 244442 68899999999874 33 6688888776555544 456677888998988 9999999999998876544
Q ss_pred ccee---EEEeecCc
Q 020784 302 ISAQ---SGLWLSSA 313 (321)
Q Consensus 302 ~~~~---~~~s~d~~ 313 (321)
.... -++.++++
T Consensus 389 s~~e~d~~sv~~~sr 403 (425)
T KOG2695|consen 389 SASEVDIPSVAFDSR 403 (425)
T ss_pred ccccccccceehhcc
Confidence 3322 14455543
No 296
>KOG2041 consensus WD40 repeat protein [General function prediction only]
Probab=98.06 E-value=6.9e-05 Score=72.19 Aligned_cols=222 Identities=14% Similarity=0.098 Sum_probs=132.9
Q ss_pred CCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeE---------------EeeeecCCceEEEEEecCCCeEEEEeC
Q 020784 84 PPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIF---------------RRDFERGGGIGVVEMLFRCNILALVGG 147 (321)
Q Consensus 84 ~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~---------------~~~~~~~~~v~~v~~~~~~~~~~~~sg 147 (321)
...+..|++|+....++|+|+.+| ++|-.+++..... ..+. |.+.|..+.|.-....+.+..
T Consensus 13 nnvkL~c~~WNke~gyIAcgG~dGlLKVlKl~t~t~d~~~~glaa~snLsmNQtLeG-H~~sV~vvTWNe~~QKLTtSD- 90 (1189)
T KOG2041|consen 13 NNVKLHCAEWNKESGYIACGGADGLLKVLKLGTDTTDLNKSGLAAASNLSMNQTLEG-HNASVMVVTWNENNQKLTTSD- 90 (1189)
T ss_pred CCceEEEEEEcccCCeEEeccccceeEEEEccccCCcccccccccccccchhhhhcc-CcceEEEEEeccccccccccC-
Confidence 345789999999999999999988 5677664322110 1111 667777777754444443322
Q ss_pred CCCCCCCCCcEEEEeCCCCcEEEEEe---eCCceeEEEEeCC--eEEEE-ECCEEEEEEcCCcEEEE-EEeccCCCCceE
Q 020784 148 GPDPQYPLNKVMIWDDHQSRCIGELS---FRSEVRSVKLRRD--RIIVV-LEQKIFVYNFADLKLLH-QIETIANPKGLC 220 (321)
Q Consensus 148 ~~~~~~~d~~v~iWD~~~~~~~~~~~---~~~~v~~v~~~~~--~~~~~-~~~~I~iwd~~~~~~~~-~l~~~~~~~~~~ 220 (321)
.+|-|.||-+-+|....+.. -.+.|.+++|+.+ ++.++ .|+.|.+=.+...++.. .+++ ....
T Consensus 91 ------t~GlIiVWmlykgsW~EEMiNnRnKSvV~SmsWn~dG~kIcIvYeDGavIVGsvdGNRIwgKeLkg----~~l~ 160 (1189)
T KOG2041|consen 91 ------TSGLIIVWMLYKGSWCEEMINNRNKSVVVSMSWNLDGTKICIVYEDGAVIVGSVDGNRIWGKELKG----QLLA 160 (1189)
T ss_pred ------CCceEEEEeeecccHHHHHhhCcCccEEEEEEEcCCCcEEEEEEccCCEEEEeeccceecchhcch----hecc
Confidence 57999999887776544332 2346888999865 34444 34555544443322211 1111 1111
Q ss_pred EEeeCCCceEEEeecCCCCcEEEEeeCCc--------ceEE----eeccccceeEEEEC--------CCCCEEEEEeCCC
Q 020784 221 AVSQGVGSLVLVCPGLQKGQVRVEHYASK--------RTKF----IMAHDSRIACFALT--------QDGQLLATSSTKG 280 (321)
Q Consensus 221 ~~s~~~d~~~la~sGs~dg~V~i~d~~~~--------~~~~----l~~H~~~V~~vafs--------pdg~~las~S~Dg 280 (321)
.+.+.+|...+.+ +-.+|.+.++|.+.. .... +......|-.+.|. ||...||.|-..|
T Consensus 161 hv~ws~D~~~~Lf-~~ange~hlydnqgnF~~Kl~~~c~Vn~tg~~s~~~~kia~i~w~~g~~~~v~pdrP~lavcy~nG 239 (1189)
T KOG2041|consen 161 HVLWSEDLEQALF-KKANGETHLYDNQGNFERKLEKDCEVNGTGIFSNFPTKIAEIEWNTGPYQPVPPDRPRLAVCYANG 239 (1189)
T ss_pred ceeecccHHHHHh-hhcCCcEEEecccccHHHhhhhceEEeeeeeecCCCccccceeeccCccccCCCCCCEEEEEEcCc
Confidence 2233444444443 788899999886532 1111 11112235555553 4778899998888
Q ss_pred cEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEee
Q 020784 281 TLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 281 t~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~~ 319 (321)
. ++|-.-.+-..-.-+..|........+++|.+||||-
T Consensus 240 r-~QiMR~eND~~Pvv~dtgm~~vgakWnh~G~vLAvcG 277 (1189)
T KOG2041|consen 240 R-MQIMRSENDPEPVVVDTGMKIVGAKWNHNGAVLAVCG 277 (1189)
T ss_pred e-ehhhhhcCCCCCeEEecccEeecceecCCCcEEEEcc
Confidence 8 8887665544444566777777778899999999973
No 297
>PF11768 DUF3312: Protein of unknown function (DUF3312); InterPro: IPR024511 This is a eukaryotic family of uncharacterised proteins that contain WD40 repeats.
Probab=98.05 E-value=0.00053 Score=65.09 Aligned_cols=117 Identities=16% Similarity=0.204 Sum_probs=75.0
Q ss_pred EEeeCCceeEEEEeC---CeEEEEE-----CC----EEEEEEcCCcEE--EEEEec-cCCCCceEEEeeCCCceEEEeec
Q 020784 171 ELSFRSEVRSVKLRR---DRIIVVL-----EQ----KIFVYNFADLKL--LHQIET-IANPKGLCAVSQGVGSLVLVCPG 235 (321)
Q Consensus 171 ~~~~~~~v~~v~~~~---~~~~~~~-----~~----~I~iwd~~~~~~--~~~l~~-~~~~~~~~~~s~~~d~~~la~sG 235 (321)
.+.....+.++.|+. ..+.... ++ .-++|++...+. +....- ....+.+|+.++ +...++. |
T Consensus 201 yirTE~dPl~~~Fs~~~~~qi~tVE~s~s~~g~~~~d~ciYE~~r~klqrvsvtsipL~s~v~~ca~sp--~E~kLvl-G 277 (545)
T PF11768_consen 201 YIRTENDPLDVEFSLNQPYQIHTVEQSISVKGEPSADSCIYECSRNKLQRVSVTSIPLPSQVICCARSP--SEDKLVL-G 277 (545)
T ss_pred EEEecCCcEEEEccCCCCcEEEEEEEecCCCCCceeEEEEEEeecCceeEEEEEEEecCCcceEEecCc--ccceEEE-E
Confidence 344445667777764 2333321 12 456788754432 221111 122344555555 4455664 9
Q ss_pred CCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCc
Q 020784 236 LQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGT 292 (321)
Q Consensus 236 s~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~ 292 (321)
..||.|.+||...+ ...+..+.-.++.++|+|+|..|+.|+..|. +.+||+.-.-
T Consensus 278 C~DgSiiLyD~~~~-~t~~~ka~~~P~~iaWHp~gai~~V~s~qGe-lQ~FD~ALsp 332 (545)
T PF11768_consen 278 CEDGSIILYDTTRG-VTLLAKAEFIPTLIAWHPDGAIFVVGSEQGE-LQCFDMALSP 332 (545)
T ss_pred ecCCeEEEEEcCCC-eeeeeeecccceEEEEcCCCcEEEEEcCCce-EEEEEeecCc
Confidence 99999999997554 4444456677899999999999999998898 9999988544
No 298
>KOG1912 consensus WD40 repeat protein [General function prediction only]
Probab=98.05 E-value=0.0005 Score=67.01 Aligned_cols=201 Identities=11% Similarity=0.064 Sum_probs=128.1
Q ss_pred CeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCC----------CeEEEEeCCCCCCCCCC
Q 020784 87 TLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRC----------NILALVGGGPDPQYPLN 156 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~----------~~~~~~sg~~~~~~~d~ 156 (321)
.-.++.|++.| +||-|+..-|.|-|..+.+.+...++ |...|..|.|.+.. ..+.+++++ ..|
T Consensus 17 N~~A~Dw~~~G-LiAygshslV~VVDs~s~q~iqsie~-h~s~V~~VrWap~~~p~~llS~~~~~lliAsaD-----~~G 89 (1062)
T KOG1912|consen 17 NRNAADWSPSG-LIAYGSHSLVSVVDSRSLQLIQSIEL-HQSAVTSVRWAPAPSPRDLLSPSSSQLLIASAD-----ISG 89 (1062)
T ss_pred cccccccCccc-eEEEecCceEEEEehhhhhhhhcccc-CccceeEEEeccCCCchhccCccccceeEEecc-----ccC
Confidence 45578899988 58999988888999888887777776 67889999986532 223344433 459
Q ss_pred cEEEEeCCCCcEEEEEeeCC-ceeEEEEeC------CeEEEE-ECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCC-C
Q 020784 157 KVMIWDDHQSRCIGELSFRS-EVRSVKLRR------DRIIVV-LEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGV-G 227 (321)
Q Consensus 157 ~v~iWD~~~~~~~~~~~~~~-~v~~v~~~~------~~~~~~-~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~-d 227 (321)
.|.+||+..+..+..++++. ++..++|-+ +.+++. ..++|-+||..+|+.+.+......+. .+|..+| |
T Consensus 90 rIil~d~~~~s~~~~l~~~~~~~qdl~W~~~rd~Srd~LlaIh~ss~lvLwntdtG~k~Wk~~ys~~iL--s~f~~DPfd 167 (1062)
T KOG1912|consen 90 RIILVDFVLASVINWLSHSNDSVQDLCWVPARDDSRDVLLAIHGSSTLVLWNTDTGEKFWKYDYSHEIL--SCFRVDPFD 167 (1062)
T ss_pred cEEEEEehhhhhhhhhcCCCcchhheeeeeccCcchheeEEecCCcEEEEEEccCCceeeccccCCcce--eeeeeCCCC
Confidence 99999999988887777654 777888743 334444 34699999999999888776544433 3344443 2
Q ss_pred ceEEEeecCCCCcEEE-EeeCCc------ceEE-eecccc-------------------------ceeEEEECCCCCEEE
Q 020784 228 SLVLVCPGLQKGQVRV-EHYASK------RTKF-IMAHDS-------------------------RIACFALTQDGQLLA 274 (321)
Q Consensus 228 ~~~la~sGs~dg~V~i-~d~~~~------~~~~-l~~H~~-------------------------~V~~vafspdg~~la 274 (321)
-.-+.+.|+ .|.|.+ -++... .... -..|.+ ..-..+|+|.-+...
T Consensus 168 ~rh~~~l~s-~g~vl~~~~l~~sep~~pgk~~qI~sd~Sdl~~lere~at~ns~ts~~~sa~fity~a~faf~p~~rn~l 246 (1062)
T KOG1912|consen 168 SRHFCVLGS-KGFVLSCKDLGLSEPDVPGKEFQITSDHSDLAHLERETATGNSTTSTPASAYFITYCAQFAFSPHWRNIL 246 (1062)
T ss_pred cceEEEEcc-CceEEEEeccCCCCCCCCceeEEEecCccchhhhhhhhhccccccCCCcchhHHHHHHhhhcChhhhceE
Confidence 222333344 456666 333211 1111 112221 123367788754333
Q ss_pred EEeCCCcEEEEEEcCCCcEEEEEe
Q 020784 275 TSSTKGTLVRIFNTLDGTLLQEEC 298 (321)
Q Consensus 275 s~S~Dgt~IrIWd~~tg~~i~~~~ 298 (321)
-.-..+. +.|+|++-..++....
T Consensus 247 fi~~pre-llv~dle~~~~l~vvp 269 (1062)
T KOG1912|consen 247 FITFPRE-LLVFDLEYECCLAVVP 269 (1062)
T ss_pred EEEeccc-eEEEcchhhceeEEEE
Confidence 3344667 8899999877776653
No 299
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=98.02 E-value=0.001 Score=62.00 Aligned_cols=183 Identities=15% Similarity=0.150 Sum_probs=107.0
Q ss_pred CCCEEEEEcCC-cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEee
Q 020784 96 DHGCFAAGTDH-GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSF 174 (321)
Q Consensus 96 dg~~lasg~~~-gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~ 174 (321)
++..++.++.+ .+..+|.++++....... .+.+...-.. .++.+.+.. .++.|..||.++|+.+-++..
T Consensus 104 ~~~~v~v~~~~g~l~ald~~tG~~~W~~~~--~~~~~~~p~v-~~~~v~v~~-------~~g~l~a~d~~tG~~~W~~~~ 173 (377)
T TIGR03300 104 DGGLVFVGTEKGEVIALDAEDGKELWRAKL--SSEVLSPPLV-ANGLVVVRT-------NDGRLTALDAATGERLWTYSR 173 (377)
T ss_pred cCCEEEEEcCCCEEEEEECCCCcEeeeecc--CceeecCCEE-ECCEEEEEC-------CCCeEEEEEcCCCceeeEEcc
Confidence 35556666654 477889889988776654 3332211111 234444444 468899999999998777655
Q ss_pred CCcee------EEEEeCCeEEEEE-CCEEEEEEcCCcEEEEEEeccCCC-----------CceEEEeeCCCceEEEeecC
Q 020784 175 RSEVR------SVKLRRDRIIVVL-EQKIFVYNFADLKLLHQIETIANP-----------KGLCAVSQGVGSLVLVCPGL 236 (321)
Q Consensus 175 ~~~v~------~v~~~~~~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~-----------~~~~~~s~~~d~~~la~sGs 236 (321)
..... +.....+.++++. ++.+..+|..+++.+.+....... .....+ . ++.+++ ++
T Consensus 174 ~~~~~~~~~~~sp~~~~~~v~~~~~~g~v~ald~~tG~~~W~~~~~~~~g~~~~~~~~~~~~~p~~--~-~~~vy~--~~ 248 (377)
T TIGR03300 174 VTPALTLRGSASPVIADGGVLVGFAGGKLVALDLQTGQPLWEQRVALPKGRTELERLVDVDGDPVV--D-GGQVYA--VS 248 (377)
T ss_pred CCCceeecCCCCCEEECCEEEEECCCCEEEEEEccCCCEeeeeccccCCCCCchhhhhccCCccEE--E-CCEEEE--EE
Confidence 43221 1122334555554 469999999998876654321100 001111 1 234443 56
Q ss_pred CCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEE
Q 020784 237 QKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEE 297 (321)
Q Consensus 237 ~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~ 297 (321)
.+|.+..+|.+++.+.--..... ....+ .++.++..++.||. |..+|..+|+.+-++
T Consensus 249 ~~g~l~a~d~~tG~~~W~~~~~~-~~~p~--~~~~~vyv~~~~G~-l~~~d~~tG~~~W~~ 305 (377)
T TIGR03300 249 YQGRVAALDLRSGRVLWKRDASS-YQGPA--VDDNRLYVTDADGV-VVALDRRSGSELWKN 305 (377)
T ss_pred cCCEEEEEECCCCcEEEeeccCC-ccCce--EeCCEEEEECCCCe-EEEEECCCCcEEEcc
Confidence 78888889987765432111111 12222 24566777788999 999999999987655
No 300
>KOG2066 consensus Vacuolar assembly/sorting protein VPS41 [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.01 E-value=0.00067 Score=66.36 Aligned_cols=154 Identities=14% Similarity=0.107 Sum_probs=101.7
Q ss_pred CCCCCCeEEEEEcCC-------------CCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecC----CCeEE
Q 020784 82 SSPPPTLLHISFNQD-------------HGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFR----CNILA 143 (321)
Q Consensus 82 ~~~~~~V~~v~fs~d-------------g~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~----~~~~~ 143 (321)
..|.+.|.-..+.-+ |.++|++++|| |.|-.+.+.+......| +..+..++++++ ....
T Consensus 55 GtH~g~v~~~~~~~~~~~~~~~s~~~~~Gey~asCS~DGkv~I~sl~~~~~~~~~df--~rpiksial~Pd~~~~~sk~- 131 (846)
T KOG2066|consen 55 GTHRGAVYLTTCQGNPKTNFDHSSSILEGEYVASCSDDGKVVIGSLFTDDEITQYDF--KRPIKSIALHPDFSRQQSKQ- 131 (846)
T ss_pred ccccceEEEEecCCcccccccccccccCCceEEEecCCCcEEEeeccCCccceeEec--CCcceeEEeccchhhhhhhh-
Confidence 456666666665554 99999999988 88988888887777777 678888888876 1222
Q ss_pred EEeCCCCCCCCCCcEEEEeCCC---CcEEEEEeeCCceeEEEEeCCeEEEEECCEEEEEEcCCcEEEEEEeccCCCC---
Q 020784 144 LVGGGPDPQYPLNKVMIWDDHQ---SRCIGELSFRSEVRSVKLRRDRIIVVLEQKIFVYNFADLKLLHQIETIANPK--- 217 (321)
Q Consensus 144 ~~sg~~~~~~~d~~v~iWD~~~---~~~~~~~~~~~~v~~v~~~~~~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~--- 217 (321)
+++||. .| +.++.-+- ...+......+.|.+++|..+.++-+.+..|++||+...+.+..++-.....
T Consensus 132 fv~GG~-----ag-lvL~er~wlgnk~~v~l~~~eG~I~~i~W~g~lIAWand~Gv~vyd~~~~~~l~~i~~p~~~~R~e 205 (846)
T KOG2066|consen 132 FVSGGM-----AG-LVLSERNWLGNKDSVVLSEGEGPIHSIKWRGNLIAWANDDGVKVYDTPTRQRLTNIPPPSQSVRPE 205 (846)
T ss_pred eeecCc-----ce-EEEehhhhhcCccceeeecCccceEEEEecCcEEEEecCCCcEEEeccccceeeccCCCCCCCCcc
Confidence 333331 24 76765332 2222223455789999999999999999999999999888877765433211
Q ss_pred -ceEEEeeCCCceEEEeecCCCCcEEEEeeC
Q 020784 218 -GLCAVSQGVGSLVLVCPGLQKGQVRVEHYA 247 (321)
Q Consensus 218 -~~~~~s~~~d~~~la~sGs~dg~V~i~d~~ 247 (321)
.-+.+.+.++..+++ |-.| +|+|...+
T Consensus 206 ~fpphl~W~~~~~LVI--GW~d-~v~i~~I~ 233 (846)
T KOG2066|consen 206 LFPPHLHWQDEDRLVI--GWGD-SVKICSIK 233 (846)
T ss_pred cCCCceEecCCCeEEE--ecCC-eEEEEEEe
Confidence 223444444444443 6665 66664444
No 301
>PF04762 IKI3: IKI3 family; InterPro: IPR006849 Members of this family are components of the elongator multi-subunit component of a novel RNA polymerase II holoenzyme for transcriptional elongation [].
Probab=98.01 E-value=0.0027 Score=65.76 Aligned_cols=194 Identities=16% Similarity=0.180 Sum_probs=116.7
Q ss_pred CeEEEEEcCCCCEEEEEcC-------CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEE
Q 020784 87 TLLHISFNQDHGCFAAGTD-------HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVM 159 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~-------~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~ 159 (321)
.-..|+|-.||.|||+.+- +.+|||+-+ +.....-+- -.+--..++|.|.++++|.+.--. +...|.
T Consensus 211 ~~~~ISWRGDG~yFAVss~~~~~~~~R~iRVy~Re-G~L~stSE~-v~gLe~~l~WrPsG~lIA~~q~~~----~~~~Vv 284 (928)
T PF04762_consen 211 GRVRISWRGDGEYFAVSSVEPETGSRRVIRVYSRE-GELQSTSEP-VDGLEGALSWRPSGNLIASSQRLP----DRHDVV 284 (928)
T ss_pred CceEEEECCCCcEEEEEEEEcCCCceeEEEEECCC-ceEEecccc-CCCccCCccCCCCCCEEEEEEEcC----CCcEEE
Confidence 4567999999999998763 237799866 333222221 123345678999999998877321 235566
Q ss_pred EEeCCCCcEEEEEeeC-----CceeEEEEeCCe--EEEEECCEEEEEEcCCc--EEEEEEeccCCC-CceEEEeeCCCce
Q 020784 160 IWDDHQSRCIGELSFR-----SEVRSVKLRRDR--IIVVLEQKIFVYNFADL--KLLHQIETIANP-KGLCAVSQGVGSL 229 (321)
Q Consensus 160 iWD~~~~~~~~~~~~~-----~~v~~v~~~~~~--~~~~~~~~I~iwd~~~~--~~~~~l~~~~~~-~~~~~~s~~~d~~ 229 (321)
+|. ++|..+.+|... ..|..+.|+.+. +++...+.|.+|-..+. -+.+.+...... ...+.+++.....
T Consensus 285 FfE-rNGLrhgeF~l~~~~~~~~v~~l~Wn~ds~iLAv~~~~~vqLWt~~NYHWYLKqei~~~~~~~~~~~~Wdpe~p~~ 363 (928)
T PF04762_consen 285 FFE-RNGLRHGEFTLRFDPEEEKVIELAWNSDSEILAVWLEDRVQLWTRSNYHWYLKQEIRFSSSESVNFVKWDPEKPLR 363 (928)
T ss_pred EEe-cCCcEeeeEecCCCCCCceeeEEEECCCCCEEEEEecCCceEEEeeCCEEEEEEEEEccCCCCCCceEECCCCCCE
Confidence 665 455566666654 368999999764 55656778999998763 344444432221 1223443332223
Q ss_pred EEEeecCCCCcEEE----EeeCCc---------ceEE----------e-------------eccccceeEEEECCCCCEE
Q 020784 230 VLVCPGLQKGQVRV----EHYASK---------RTKF----------I-------------MAHDSRIACFALTQDGQLL 273 (321)
Q Consensus 230 ~la~sGs~dg~V~i----~d~~~~---------~~~~----------l-------------~~H~~~V~~vafspdg~~l 273 (321)
+.+ ...+|.+.+ |+.... ...+ | -.....|.+++|++++..+
T Consensus 364 L~v--~t~~g~~~~~~~~~~v~~s~~~~~~D~g~vaVIDG~~lllTpf~~a~VPPPMs~~~l~~~~~v~~vaf~~~~~~~ 441 (928)
T PF04762_consen 364 LHV--LTSNGQYEIYDFAWDVSRSPGSSPNDNGTVAVIDGNKLLLTPFRRAVVPPPMSSYELELPSPVNDVAFSPSNSRF 441 (928)
T ss_pred EEE--EecCCcEEEEEEEEEEEecCCCCccCceEEEEEeCCeEEEecccccCCCchHhceEEcCCCCcEEEEEeCCCCeE
Confidence 333 233344433 221100 0001 1 1135789999999999889
Q ss_pred EEEeCCCcEEEEEEcCC
Q 020784 274 ATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 274 as~S~Dgt~IrIWd~~t 290 (321)
|.-..||+ |.+|....
T Consensus 442 avl~~d~~-l~~~~~~~ 457 (928)
T PF04762_consen 442 AVLTSDGS-LSIYEWDL 457 (928)
T ss_pred EEEECCCC-EEEEEecC
Confidence 99999999 99998544
No 302
>PF00400 WD40: WD domain, G-beta repeat; InterPro: IPR019781 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events.; PDB: 2ZKQ_a 3CFV_B 3CFS_B 1PEV_A 1NR0_A 1VYH_T 3RFH_A 3O2Z_T 3FRX_C 3U5G_g ....
Probab=98.01 E-value=1.3e-05 Score=48.56 Aligned_cols=32 Identities=19% Similarity=0.487 Sum_probs=28.2
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEE
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDHG-FRIYN 112 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~ 112 (321)
...|.+.|++|+|+|++.+|++|+.|+ ++|||
T Consensus 7 ~~~h~~~i~~i~~~~~~~~~~s~~~D~~i~vwd 39 (39)
T PF00400_consen 7 FRGHSSSINSIAWSPDGNFLASGSSDGTIRVWD 39 (39)
T ss_dssp EESSSSSEEEEEEETTSSEEEEEETTSEEEEEE
T ss_pred EcCCCCcEEEEEEecccccceeeCCCCEEEEEC
Confidence 357888999999999999999999855 88997
No 303
>KOG0280 consensus Uncharacterized conserved protein [Amino acid transport and metabolism]
Probab=98.00 E-value=0.00034 Score=60.88 Aligned_cols=191 Identities=14% Similarity=0.065 Sum_probs=105.3
Q ss_pred eEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeE--EeeeecCCceEEEEEe-cCCCeEEEEeCCCCCCCCCCcEEEEeC
Q 020784 88 LLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIF--RRDFERGGGIGVVEML-FRCNILALVGGGPDPQYPLNKVMIWDD 163 (321)
Q Consensus 88 V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~--~~~~~~~~~v~~v~~~-~~~~~~~~~sg~~~~~~~d~~v~iWD~ 163 (321)
-.++.|++-|.-++++..+| +.+-+......+. .++. |+-..-..++. .+++++.+.+ +|+.+.-||.
T Consensus 124 ~lslD~~~~~~~i~vs~s~G~~~~v~~t~~~le~vq~wk~-He~E~Wta~f~~~~pnlvytGg-------DD~~l~~~D~ 195 (339)
T KOG0280|consen 124 ALSLDISTSGTKIFVSDSRGSISGVYETEMVLEKVQTWKV-HEFEAWTAKFSDKEPNLVYTGG-------DDGSLSCWDI 195 (339)
T ss_pred eeEEEeeccCceEEEEcCCCcEEEEecceeeeeecccccc-cceeeeeeecccCCCceEEecC-------CCceEEEEEe
Confidence 45778899898888888766 5433322222222 2221 23333333332 2344444433 5799999999
Q ss_pred C-CCcEEEE--EeeCCceeEEEEeCC---eEEEEE-CCEEEEEEcCCc-EEEEEEeccCCCCceEEEeeCCC--ceEEEe
Q 020784 164 H-QSRCIGE--LSFRSEVRSVKLRRD---RIIVVL-EQKIFVYNFADL-KLLHQIETIANPKGLCAVSQGVG--SLVLVC 233 (321)
Q Consensus 164 ~-~~~~~~~--~~~~~~v~~v~~~~~---~~~~~~-~~~I~iwd~~~~-~~~~~l~~~~~~~~~~~~s~~~d--~~~la~ 233 (321)
+ .+.++.. ..++..|.++.-++. .++.+. +..|++||.+++ +.+. ......++..|...+. +.+|++
T Consensus 196 R~p~~~i~~n~kvH~~GV~SI~ss~~~~~~I~TGsYDe~i~~~DtRnm~kPl~---~~~v~GGVWRi~~~p~~~~~lL~~ 272 (339)
T KOG0280|consen 196 RIPKTFIWHNSKVHTSGVVSIYSSPPKPTYIATGSYDECIRVLDTRNMGKPLF---KAKVGGGVWRIKHHPEIFHRLLAA 272 (339)
T ss_pred cCCcceeeecceeeecceEEEecCCCCCceEEEeccccceeeeehhcccCccc---cCccccceEEEEecchhhhHHHHH
Confidence 8 3333322 234456777777654 344443 579999999864 3322 1122245666655543 233442
Q ss_pred ecCCCCcEEEEeeC---Cc---ceEEeeccccceeEEEECCCCCEEEEEeC-CCcEEE-EEEcCCCc
Q 020784 234 PGLQKGQVRVEHYA---SK---RTKFIMAHDSRIACFALTQDGQLLATSST-KGTLVR-IFNTLDGT 292 (321)
Q Consensus 234 sGs~dg~V~i~d~~---~~---~~~~l~~H~~~V~~vafspdg~~las~S~-Dgt~Ir-IWd~~tg~ 292 (321)
+=.+| .+|-+.+ .+ .....+.|.+-+..-.|......|||||. |+. ++ +|---|+.
T Consensus 273 -CMh~G-~ki~~~~~~~~e~~~~~~s~~~hdSl~YG~DWd~~~~~lATCsFYDk~-~~~~Wl~~t~~ 336 (339)
T KOG0280|consen 273 -CMHNG-AKILDSSDKVLEFQIVLPSDKIHDSLCYGGDWDSKDSFLATCSFYDKK-IRQLWLHITGE 336 (339)
T ss_pred -HHhcC-ceEEEecccccchheeeeccccccceeeccccccccceeeeeeccccc-eeeeeeeccCC
Confidence 33333 2222222 12 23356778877777777555567999875 666 55 88655543
No 304
>smart00320 WD40 WD40 repeats. Note that these repeats are permuted with respect to the structural repeats (blades) of the beta propeller domain.
Probab=97.97 E-value=2.1e-05 Score=45.93 Aligned_cols=37 Identities=27% Similarity=0.564 Sum_probs=33.3
Q ss_pred ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEE
Q 020784 250 RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 250 ~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd 287 (321)
....+..|...|++++|++++.++++++.|+. |++|+
T Consensus 4 ~~~~~~~~~~~i~~~~~~~~~~~~~~~~~d~~-~~~~~ 40 (40)
T smart00320 4 LLKTLKGHTGPVTSVAFSPDGKYLASASDDGT-IKLWD 40 (40)
T ss_pred EEEEEEecCCceeEEEECCCCCEEEEecCCCe-EEEcC
Confidence 34567789999999999999999999999999 99996
No 305
>KOG4190 consensus Uncharacterized conserved protein [Function unknown]
Probab=97.96 E-value=4.2e-05 Score=71.60 Aligned_cols=204 Identities=13% Similarity=0.213 Sum_probs=124.7
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEc-CCcEEEEEecCC-------ceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCC
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGT-DHGFRIYNCDPF-------REIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQY 153 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~-~~gv~vw~~~~~-------~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~ 153 (321)
.+|.+.|+.+.--.+.+-|++++ |++|++|.+.+. .+.+.+.. |..+|..+.+..+-+.++.+
T Consensus 732 ~GH~~~iRai~AidNENSFiSASkDKTVKLWSik~EgD~~~tsaCQfTY~a-Hkk~i~~igfL~~lr~i~Sc-------- 802 (1034)
T KOG4190|consen 732 TGHQEKIRAIAAIDNENSFISASKDKTVKLWSIKPEGDEIGTSACQFTYQA-HKKPIHDIGFLADLRSIASC-------- 802 (1034)
T ss_pred cCcHHHhHHHHhcccccceeeccCCceEEEEEeccccCccccceeeeEhhh-ccCcccceeeeeccceeeec--------
Confidence 56778888887555555566655 578999998543 23344433 67777777776666666553
Q ss_pred CCCcEEEEeCCCCcEEEEEee---CC---ceeEEEEeCCeEEEE--E-CCEEEEEEcCCcEEEEEEeccC--CC-CceEE
Q 020784 154 PLNKVMIWDDHQSRCIGELSF---RS---EVRSVKLRRDRIIVV--L-EQKIFVYNFADLKLLHQIETIA--NP-KGLCA 221 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~~~~~---~~---~v~~v~~~~~~~~~~--~-~~~I~iwd~~~~~~~~~l~~~~--~~-~~~~~ 221 (321)
|+.|.+||.=.+..+....- ++ .|.++.--...++++ + ..+|+++|.+..+-...++... .+ ..+-+
T Consensus 803 -D~giHlWDPFigr~Laq~~dapk~~a~~~ikcl~nv~~~iliAgcsaeSTVKl~DaRsce~~~E~kVcna~~Pna~~R~ 881 (1034)
T KOG4190|consen 803 -DGGIHLWDPFIGRLLAQMEDAPKEGAGGNIKCLENVDRHILIAGCSAESTVKLFDARSCEWTCELKVCNAPGPNALTRA 881 (1034)
T ss_pred -cCcceeecccccchhHhhhcCcccCCCceeEecccCcchheeeeccchhhheeeecccccceeeEEeccCCCCchheeE
Confidence 57799999766655442221 12 344444322233333 3 3699999999877666665432 22 22334
Q ss_pred EeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEE-EEcCCCcEEEEEe
Q 020784 222 VSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRI-FNTLDGTLLQEEC 298 (321)
Q Consensus 222 ~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrI-Wd~~tg~~i~~~~ 298 (321)
+...+.|+.+|+ |-.+|.|.+.|.+++. +..++.-.-....++ -|..+.||....|.+ +.| |...+|....+.+
T Consensus 882 iaVa~~GN~lAa-~LSnGci~~LDaR~G~vINswrpmecdllqla-apsdq~L~~saldHs-laVnWhaldgimh~q~k 957 (1034)
T KOG4190|consen 882 IAVADKGNKLAA-ALSNGCIAILDARNGKVINSWRPMECDLLQLA-APSDQALAQSALDHS-LAVNWHALDGIMHLQDK 957 (1034)
T ss_pred EEeccCcchhhH-HhcCCcEEEEecCCCceeccCCcccchhhhhc-CchhHHHHhhcccce-eEeeehhcCCeeeeccC
Confidence 444455678884 8889999998877765 344443332233333 255667777777888 777 8877776655543
No 306
>KOG2041 consensus WD40 repeat protein [General function prediction only]
Probab=97.94 E-value=0.00055 Score=66.23 Aligned_cols=226 Identities=11% Similarity=0.083 Sum_probs=133.9
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCCcE-EEEEecCCceeEEee-eecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcE
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDHGF-RIYNCDPFREIFRRD-FERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~gv-~vw~~~~~~~~~~~~-~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
..+|.+.|.-+.|+.+.+.|.+...+|+ .||=+-.+...-... .+....|..++|.-++..++++- .||.|
T Consensus 67 LeGH~~sV~vvTWNe~~QKLTtSDt~GlIiVWmlykgsW~EEMiNnRnKSvV~SmsWn~dG~kIcIvY-------eDGav 139 (1189)
T KOG2041|consen 67 LEGHNASVMVVTWNENNQKLTTSDTSGLIIVWMLYKGSWCEEMINNRNKSVVVSMSWNLDGTKICIVY-------EDGAV 139 (1189)
T ss_pred hccCcceEEEEEeccccccccccCCCceEEEEeeecccHHHHHhhCcCccEEEEEEEcCCCcEEEEEE-------ccCCE
Confidence 3578899999999999999988888885 599876654211111 11245677788888888887776 56777
Q ss_pred EEEeCCCCcEE-EEEeeCCceeEEEEeCCeE---EEEECCEEEEEEcCCc-------EEEEEEeccC--CCCceEEEe--
Q 020784 159 MIWDDHQSRCI-GELSFRSEVRSVKLRRDRI---IVVLEQKIFVYNFADL-------KLLHQIETIA--NPKGLCAVS-- 223 (321)
Q Consensus 159 ~iWD~~~~~~~-~~~~~~~~v~~v~~~~~~~---~~~~~~~I~iwd~~~~-------~~~~~l~~~~--~~~~~~~~s-- 223 (321)
.|=.++..+.- .+++.. ....+.|+++.- +.-..+.+.+||.+.. ++.....+.. .+..+..+.
T Consensus 140 IVGsvdGNRIwgKeLkg~-~l~hv~ws~D~~~~Lf~~ange~hlydnqgnF~~Kl~~~c~Vn~tg~~s~~~~kia~i~w~ 218 (1189)
T KOG2041|consen 140 IVGSVDGNRIWGKELKGQ-LLAHVLWSEDLEQALFKKANGETHLYDNQGNFERKLEKDCEVNGTGIFSNFPTKIAEIEWN 218 (1189)
T ss_pred EEEeeccceecchhcchh-eccceeecccHHHHHhhhcCCcEEEecccccHHHhhhhceEEeeeeeecCCCccccceeec
Confidence 66555433211 111111 123456666532 2223468889987421 1111111110 011111111
Q ss_pred ------eCCCceEEEeecCCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCc--------EEEEEEcC
Q 020784 224 ------QGVGSLVLVCPGLQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGT--------LVRIFNTL 289 (321)
Q Consensus 224 ------~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt--------~IrIWd~~ 289 (321)
..||...+|+ +-.+|.+.|....+.+.-.+-.-...|..+.|+++|..||.++.|.. .|..+ ..
T Consensus 219 ~g~~~~v~pdrP~lav-cy~nGr~QiMR~eND~~Pvv~dtgm~~vgakWnh~G~vLAvcG~~~da~~~~d~n~v~Fy-sp 296 (1189)
T KOG2041|consen 219 TGPYQPVPPDRPRLAV-CYANGRMQIMRSENDPEPVVVDTGMKIVGAKWNHNGAVLAVCGNDSDADEPTDSNKVHFY-SP 296 (1189)
T ss_pred cCccccCCCCCCEEEE-EEcCceehhhhhcCCCCCeEEecccEeecceecCCCcEEEEccCcccccCccccceEEEe-cc
Confidence 1246677775 78899999965544443333333377899999999999999987642 13322 23
Q ss_pred CCcEEEEEeCCCcceeEEEeecCceEEE
Q 020784 290 DGTLLQEECCPSISAQSGLWLSSAWLRV 317 (321)
Q Consensus 290 tg~~i~~~~~g~~~~~~~~s~d~~~la~ 317 (321)
-|+.+.+++. ....+.+++|.|.=|..
T Consensus 297 ~G~i~gtlkv-pg~~It~lsWEg~gLri 323 (1189)
T KOG2041|consen 297 YGHIVGTLKV-PGSCITGLSWEGTGLRI 323 (1189)
T ss_pred chhheEEEec-CCceeeeeEEcCCceEE
Confidence 4777788864 33466788888855443
No 307
>PF04053 Coatomer_WDAD: Coatomer WD associated region ; InterPro: IPR006692 Proteins synthesised on the ribosome and processed in the endoplasmic reticulum are transported from the Golgi apparatus to the trans-Golgi network (TGN), and from there via small carrier vesicles to their final destination compartment. This traffic is bidirectional, to ensure that proteins required to form vesicles are recycled. Vesicles have specific coat proteins (such as clathrin or coatomer) that are important for cargo selection and direction of transfer []. While clathrin mediates endocytic protein transport, and transport from ER to Golgi, coatomers primarily mediate intra-Golgi transport, as well as the reverse Golgi to ER transport of dilysine-tagged proteins []. For example, the coatomer COP1 (coat protein complex 1) is responsible for reverse transport of recycled proteins from Golgi and pre-Golgi compartments back to the ER, while COPII buds vesicles from the ER to the Golgi []. Coatomers reversibly associate with Golgi (non-clathrin-coated) vesicles to mediate protein transport and for budding from Golgi membranes []. Activated small guanine triphosphatases (GTPases) attract coat proteins to specific membrane export sites, thereby linking coatomers to export cargos. As coat proteins polymerise, vesicles are formed and budded from membrane-bound organelles. Coatomer complexes also influence Golgi structural integrity, as well as the processing, activity, and endocytic recycling of LDL receptors. In mammals, coatomer complexes can only be recruited by membranes associated to ADP-ribosylation factors (ARFs), which are small GTP-binding proteins. Coatomer complexes are hetero-oligomers composed of at least an alpha, beta, beta', gamma, delta, epsilon and zeta subunits. This entry represents the WD-associated region found in coatomer subunits alpha, beta and beta' subunits. The alpha-subunit (RET1P) of the coatomer complex in Saccharomyces cerevisiae (Baker's yeast), participates in membrane transport between the endoplasmic reticulum and Golgi apparatus. The protein contains six WD-40 repeat motifs in its N-terminal region []. More information about these proteins can be found at Protein of the Month: Clathrin [].; GO: 0005198 structural molecule activity, 0006886 intracellular protein transport, 0016192 vesicle-mediated transport, 0030117 membrane coat; PDB: 3MKQ_B.
Probab=97.87 E-value=0.0068 Score=57.56 Aligned_cols=162 Identities=15% Similarity=0.162 Sum_probs=86.6
Q ss_pred CeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCC
Q 020784 87 TLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQS 166 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~ 166 (321)
....++++|+|++++.++++...||.....+.. .+ +......|.. .+.+|+.. ..++|+|+.--+.
T Consensus 34 ~p~~ls~npngr~v~V~g~geY~iyt~~~~r~k---~~---G~g~~~vw~~-~n~yAv~~-------~~~~I~I~kn~~~ 99 (443)
T PF04053_consen 34 YPQSLSHNPNGRFVLVCGDGEYEIYTALAWRNK---AF---GSGLSFVWSS-RNRYAVLE-------SSSTIKIYKNFKN 99 (443)
T ss_dssp --SEEEE-TTSSEEEEEETTEEEEEETTTTEEE---EE---EE-SEEEE-T-SSEEEEE--------TTS-EEEEETTEE
T ss_pred CCeeEEECCCCCEEEEEcCCEEEEEEccCCccc---cc---CceeEEEEec-CccEEEEE-------CCCeEEEEEcCcc
Confidence 356799999999999988888889884444332 11 2222334555 45677766 3478999732222
Q ss_pred cEEEEEeeCCceeEEEEeCCeEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEee
Q 020784 167 RCIGELSFRSEVRSVKLRRDRIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHY 246 (321)
Q Consensus 167 ~~~~~~~~~~~v~~v~~~~~~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~ 246 (321)
.....++....+..+.- +..+.+..++.|.+||+.+++.+++++... +-.+.+++++.++|.. +. ..+.|.+.
T Consensus 100 ~~~k~i~~~~~~~~If~-G~LL~~~~~~~i~~yDw~~~~~i~~i~v~~----vk~V~Ws~~g~~val~-t~-~~i~il~~ 172 (443)
T PF04053_consen 100 EVVKSIKLPFSVEKIFG-GNLLGVKSSDFICFYDWETGKLIRRIDVSA----VKYVIWSDDGELVALV-TK-DSIYILKY 172 (443)
T ss_dssp -TT-----SS-EEEEE--SSSEEEEETTEEEEE-TTT--EEEEESS-E-----EEEEE-TTSSEEEEE--S--SEEEEEE
T ss_pred ccceEEcCCcccceEEc-CcEEEEECCCCEEEEEhhHcceeeEEecCC----CcEEEEECCCCEEEEE-eC-CeEEEEEe
Confidence 22223444433444333 556666677789999999999999987531 3444555666778763 33 36777665
Q ss_pred CCc------------ceEEeeccccceeEEEECCC
Q 020784 247 ASK------------RTKFIMAHDSRIACFALTQD 269 (321)
Q Consensus 247 ~~~------------~~~~l~~H~~~V~~vafspd 269 (321)
... ....+......|.+.+|..|
T Consensus 173 ~~~~~~~~~~~g~e~~f~~~~E~~~~IkSg~W~~d 207 (443)
T PF04053_consen 173 NLEAVAAIPEEGVEDAFELIHEISERIKSGCWVED 207 (443)
T ss_dssp -HHHHHHBTTTB-GGGEEEEEEE-S--SEEEEETT
T ss_pred cchhcccccccCchhceEEEEEecceeEEEEEEcC
Confidence 544 44444444667888888765
No 308
>PF04841 Vps16_N: Vps16, N-terminal region; InterPro: IPR006926 This protein forms part of the Class C vacuolar protein sorting (Vps) complex. Vps16 is essential for vacuolar protein sorting, which is essential for viability in plants, but not yeast []. The Class C Vps complex is required for SNARE-mediated membrane fusion at the lysosome-like yeast vacuole. It is thought to play essential roles in membrane docking and fusion at the Golgi-to-endosome and endosome-to-vacuole stages of transport []. The role of VPS16 in this complex is not known.; GO: 0006886 intracellular protein transport, 0005737 cytoplasm
Probab=97.85 E-value=0.0072 Score=57.03 Aligned_cols=42 Identities=19% Similarity=0.205 Sum_probs=34.9
Q ss_pred ccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCC
Q 020784 258 DSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCP 300 (321)
Q Consensus 258 ~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g 300 (321)
.+++..|++||+|+++|--..+|+ +.|.+..-.+.+.++..+
T Consensus 216 ~~~i~~iavSpng~~iAl~t~~g~-l~v~ssDf~~~~~e~~~~ 257 (410)
T PF04841_consen 216 DGPIIKIAVSPNGKFIALFTDSGN-LWVVSSDFSEKLCEFDTD 257 (410)
T ss_pred CCCeEEEEECCCCCEEEEEECCCC-EEEEECcccceeEEeecC
Confidence 368999999999999999999999 888877666677677655
No 309
>KOG1912 consensus WD40 repeat protein [General function prediction only]
Probab=97.83 E-value=0.00071 Score=66.02 Aligned_cols=220 Identities=11% Similarity=0.122 Sum_probs=122.2
Q ss_pred CCCCCeEEEEEcCC-----------CC-EEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEec---CC-CeEEEE
Q 020784 83 SPPPTLLHISFNQD-----------HG-CFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLF---RC-NILALV 145 (321)
Q Consensus 83 ~~~~~V~~v~fs~d-----------g~-~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~---~~-~~~~~~ 145 (321)
.|...|+.|.|.|- .. +||++...| |.|||............ +...+..++|.+ ++ ..++..
T Consensus 53 ~h~s~V~~VrWap~~~p~~llS~~~~~lliAsaD~~GrIil~d~~~~s~~~~l~~-~~~~~qdl~W~~~rd~Srd~LlaI 131 (1062)
T KOG1912|consen 53 LHQSAVTSVRWAPAPSPRDLLSPSSSQLLIASADISGRIILVDFVLASVINWLSH-SNDSVQDLCWVPARDDSRDVLLAI 131 (1062)
T ss_pred cCccceeEEEeccCCCchhccCccccceeEEeccccCcEEEEEehhhhhhhhhcC-CCcchhheeeeeccCcchheeEEe
Confidence 45678999999762 12 455665555 88999987765544444 567777777754 33 344444
Q ss_pred eCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeE-EEEeCC--------------------------------------
Q 020784 146 GGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRS-VKLRRD-------------------------------------- 186 (321)
Q Consensus 146 sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~-v~~~~~-------------------------------------- 186 (321)
.+ ...|.+|+..+|+..-.......+.+ +.+.|.
T Consensus 132 h~-------ss~lvLwntdtG~k~Wk~~ys~~iLs~f~~DPfd~rh~~~l~s~g~vl~~~~l~~sep~~pgk~~qI~sd~ 204 (1062)
T KOG1912|consen 132 HG-------SSTLVLWNTDTGEKFWKYDYSHEILSCFRVDPFDSRHFCVLGSKGFVLSCKDLGLSEPDVPGKEFQITSDH 204 (1062)
T ss_pred cC-------CcEEEEEEccCCceeeccccCCcceeeeeeCCCCcceEEEEccCceEEEEeccCCCCCCCCceeEEEecCc
Confidence 43 47899999888876544333222221 222211
Q ss_pred ----------------------------------------eEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCC
Q 020784 187 ----------------------------------------RIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGV 226 (321)
Q Consensus 187 ----------------------------------------~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~ 226 (321)
.+++..-..+.++|++-...+..+.-..+....+.+-|++
T Consensus 205 Sdl~~lere~at~ns~ts~~~sa~fity~a~faf~p~~rn~lfi~~prellv~dle~~~~l~vvpier~~akfv~vlP~~ 284 (1062)
T KOG1912|consen 205 SDLAHLERETATGNSTTSTPASAYFITYCAQFAFSPHWRNILFITFPRELLVFDLEYECCLAVVPIERGGAKFVDVLPDP 284 (1062)
T ss_pred cchhhhhhhhhccccccCCCcchhHHHHHHhhhcChhhhceEEEEeccceEEEcchhhceeEEEEeccCCcceeEeccCC
Confidence 1233333456666666555555555555555567777777
Q ss_pred CceEEEeecCCCCcEEEEeeCCcce--EEeecc-----ccceeE-----------EEECCC-CCEEEEEeCCCcEEEEEE
Q 020784 227 GSLVLVCPGLQKGQVRVEHYASKRT--KFIMAH-----DSRIAC-----------FALTQD-GQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 227 d~~~la~sGs~dg~V~i~d~~~~~~--~~l~~H-----~~~V~~-----------vafspd-g~~las~S~Dgt~IrIWd 287 (321)
....|.+ +..||.+.||..+.... +.-.+| ...|.+ .+-.|. ...++.--.+|. +.+|.
T Consensus 285 ~rd~Lfc-lH~nG~ltirvrk~~~~~f~~~~~~l~~dl~~Q~~~vr~m~~~rp~~~~~cPs~~sa~avl~s~g~-~~~w~ 362 (1062)
T KOG1912|consen 285 RRDALFC-LHSNGRLTIRVRKEEPTEFKKPNASLSMDLGEQVHVVRPMEEFRPVIGASCPSTPSALAVLYSSGD-STFWQ 362 (1062)
T ss_pred CcceEEE-EecCCeEEEEEeeccCccccccchhhccccccceEEEeechhcccceeecCCCChhhhhhhhhcch-hHHHh
Confidence 7666664 89999999987553211 000001 111222 222343 223333334666 77999
Q ss_pred cCCCcEEEEEeCCCcceeEEEeecC
Q 020784 288 TLDGTLLQEECCPSISAQSGLWLSS 312 (321)
Q Consensus 288 ~~tg~~i~~~~~g~~~~~~~~s~d~ 312 (321)
+.+|+.-..++.+.....+-|.+.+
T Consensus 363 l~~~ri~~~~~s~~iel~~pf~f~~ 387 (1062)
T KOG1912|consen 363 LSNGRIHLDYRSSSIELVLPFDFNL 387 (1062)
T ss_pred hhcCCcCcccccccccccccccccC
Confidence 9988765544433333344444444
No 310
>KOG4532 consensus WD40-like repeat containing protein [General function prediction only]
Probab=97.80 E-value=0.00084 Score=57.90 Aligned_cols=135 Identities=5% Similarity=-0.062 Sum_probs=79.6
Q ss_pred CCCcEEEEeCCCCcEEE-EEeeCC----ceeEEEEeCCeEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCC
Q 020784 154 PLNKVMIWDDHQSRCIG-ELSFRS----EVRSVKLRRDRIIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVG 227 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~-~~~~~~----~v~~v~~~~~~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d 227 (321)
..|...+|...+.+.+. .+..+. -+...|.....+.++. +.++++.++..+... +..|.........+.++|
T Consensus 92 ~~g~fd~~~~~tn~~h~~~cd~snn~v~~~~r~cd~~~~~~i~sndht~k~~~~~~~s~~--~~~h~~~~~~ns~~~snd 169 (344)
T KOG4532|consen 92 ASGQFDLFACNTNDGHLYQCDVSNNDVTLVKRYCDLKFPLNIASNDHTGKTMVVSGDSNK--FAVHNQNLTQNSLHYSND 169 (344)
T ss_pred ccceeeeecccCcccceeeecccccchhhhhhhcccccceeeccCCcceeEEEEecCccc--ceeeccccceeeeEEcCC
Confidence 45899999988765432 222211 1223333344555554 558888887543321 222322222333344445
Q ss_pred ceEEEeecCCCCcEEEEeeCCcc---eE-EeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCc
Q 020784 228 SLVLVCPGLQKGQVRVEHYASKR---TK-FIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGT 292 (321)
Q Consensus 228 ~~~la~sGs~dg~V~i~d~~~~~---~~-~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~ 292 (321)
+.++++.|......+ +.+.... +. ....-...=.+..|+.+...||++..||+ +-|||++...
T Consensus 170 ~~~~~~Vgds~~Vf~-y~id~~sey~~~~~~a~t~D~gF~~S~s~~~~~FAv~~Qdg~-~~I~DVR~~~ 236 (344)
T KOG4532|consen 170 PSWGSSVGDSRRVFR-YAIDDESEYIENIYEAPTSDHGFYNSFSENDLQFAVVFQDGT-CAIYDVRNMA 236 (344)
T ss_pred CceEEEecCCCcceE-EEeCCccceeeeeEecccCCCceeeeeccCcceEEEEecCCc-EEEEEecccc
Confidence 588887677654444 3333222 22 23334555688999999999999999999 9999999754
No 311
>KOG4640 consensus Anaphase-promoting complex (APC), subunit 4 [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=97.76 E-value=0.00018 Score=68.52 Aligned_cols=91 Identities=16% Similarity=0.161 Sum_probs=72.5
Q ss_pred eEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEEeecccccee-EEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEE
Q 020784 219 LCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKFIMAHDSRIA-CFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEE 297 (321)
Q Consensus 219 ~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~H~~~V~-~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~ 297 (321)
+-.+-++|...++|+ +..+|.|.+..++-..+-++.-|...|+ +++|.|||++||.|=.||+ |+|-|+.+|..+..+
T Consensus 23 i~~~ewnP~~dLiA~-~t~~gelli~R~n~qRlwtip~p~~~v~~sL~W~~DGkllaVg~kdG~-I~L~Dve~~~~l~~~ 100 (665)
T KOG4640|consen 23 IKRIEWNPKMDLIAT-RTEKGELLIHRLNWQRLWTIPIPGENVTASLCWRPDGKLLAVGFKDGT-IRLHDVEKGGRLVSF 100 (665)
T ss_pred eEEEEEcCccchhhe-eccCCcEEEEEeccceeEeccCCCCccceeeeecCCCCEEEEEecCCe-EEEEEccCCCceecc
Confidence 444455666678885 9999999998888777888888888888 9999999999999999999 999999999998875
Q ss_pred eCCCcceeEEEeec
Q 020784 298 CCPSISAQSGLWLS 311 (321)
Q Consensus 298 ~~g~~~~~~~~s~d 311 (321)
...-...+....|+
T Consensus 101 ~~s~e~~is~~~w~ 114 (665)
T KOG4640|consen 101 LFSVETDISKGIWD 114 (665)
T ss_pred ccccccchheeecc
Confidence 44444444444454
No 312
>KOG2066 consensus Vacuolar assembly/sorting protein VPS41 [Intracellular trafficking, secretion, and vesicular transport]
Probab=97.66 E-value=0.0015 Score=64.09 Aligned_cols=180 Identities=13% Similarity=0.156 Sum_probs=117.4
Q ss_pred CCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC
Q 020784 86 PTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH 164 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~ 164 (321)
..+.|++++ +++|+-|..+| |.+++++-.- ...+.|... ..++.++++++ .||+|.|--+-
T Consensus 40 D~is~~av~--~~~~~~GtH~g~v~~~~~~~~~---~~~~~~s~~------~~~Gey~asCS-------~DGkv~I~sl~ 101 (846)
T KOG2066|consen 40 DAISCCAVH--DKFFALGTHRGAVYLTTCQGNP---KTNFDHSSS------ILEGEYVASCS-------DDGKVVIGSLF 101 (846)
T ss_pred hHHHHHHhh--cceeeeccccceEEEEecCCcc---ccccccccc------ccCCceEEEec-------CCCcEEEeecc
Confidence 467888887 68999999977 6688765331 111111111 45688899988 78999999999
Q ss_pred CCcEEEEEeeCCceeEEEEeCC-------eEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCC
Q 020784 165 QSRCIGELSFRSEVRSVKLRRD-------RIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQ 237 (321)
Q Consensus 165 ~~~~~~~~~~~~~v~~v~~~~~-------~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~ 237 (321)
+.+....+.++.++.+++++|+ ++++++...+.++.-+=.+.......+.....+.++++.+ .++|. .+.
T Consensus 102 ~~~~~~~~df~rpiksial~Pd~~~~~sk~fv~GG~aglvL~er~wlgnk~~v~l~~~eG~I~~i~W~g--~lIAW-and 178 (846)
T KOG2066|consen 102 TDDEITQYDFKRPIKSIALHPDFSRQQSKQFVSGGMAGLVLSERNWLGNKDSVVLSEGEGPIHSIKWRG--NLIAW-AND 178 (846)
T ss_pred CCccceeEecCCcceeEEeccchhhhhhhheeecCcceEEEehhhhhcCccceeeecCccceEEEEecC--cEEEE-ecC
Confidence 9998888999999999999987 2333333336666532111112223344445577778876 78887 444
Q ss_pred CCcEEEEeeCCcceE-Eeeccccc------eeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 238 KGQVRVEHYASKRTK-FIMAHDSR------IACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 238 dg~V~i~d~~~~~~~-~l~~H~~~------V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
+ -|+|+|...++.. .+..-... .-.+.|.++.+++ -| +..+ |+|..++.
T Consensus 179 ~-Gv~vyd~~~~~~l~~i~~p~~~~R~e~fpphl~W~~~~~LV-IG-W~d~-v~i~~I~~ 234 (846)
T KOG2066|consen 179 D-GVKVYDTPTRQRLTNIPPPSQSVRPELFPPHLHWQDEDRLV-IG-WGDS-VKICSIKK 234 (846)
T ss_pred C-CcEEEeccccceeeccCCCCCCCCcccCCCceEecCCCeEE-Ee-cCCe-EEEEEEec
Confidence 4 5888998876643 33322233 3457888766544 34 5666 99999983
No 313
>KOG1409 consensus Uncharacterized conserved protein, contains WD40 repeats and FYVE domains [Function unknown]
Probab=97.64 E-value=0.0067 Score=54.17 Aligned_cols=202 Identities=10% Similarity=0.085 Sum_probs=111.9
Q ss_pred CcccCCCCCCeEEEEEcCCCCEEEEEcC-CcEEEEEe-cCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCC
Q 020784 78 ESTSSSPPPTLLHISFNQDHGCFAAGTD-HGFRIYNC-DPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPL 155 (321)
Q Consensus 78 ~~~~~~~~~~V~~v~fs~dg~~lasg~~-~gv~vw~~-~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d 155 (321)
+.+..+|.+.|+....-|...-+.+.++ .++|||-. +.++.--...+..-....+++.......+.+.- ..
T Consensus 17 l~~~eG~~d~vn~~~l~~~e~gv~~~s~drtvrv~lkrds~q~wpsI~~~mP~~~~~~~y~~e~~~L~vg~-------~n 89 (404)
T KOG1409|consen 17 LSKIEGSQDDVNAAILIPKEEGVISVSEDRTVRVWLKRDSGQYWPSIYHYMPSPCSAMEYVSESRRLYVGQ-------DN 89 (404)
T ss_pred hhhhcCchhhhhhheeccCCCCeEEccccceeeeEEeccccccCchhhhhCCCCceEeeeeccceEEEEEE-------ec
Confidence 3334566677887777776666777776 67999954 333221111110134455555555555554443 34
Q ss_pred CcEEEEeCCC----CcEEEE-EeeCCceeEEEEe--CCeEEEEECCEEEEEEc-CCcEEEEEEeccCCCCceEEEeeCCC
Q 020784 156 NKVMIWDDHQ----SRCIGE-LSFRSEVRSVKLR--RDRIIVVLEQKIFVYNF-ADLKLLHQIETIANPKGLCAVSQGVG 227 (321)
Q Consensus 156 ~~v~iWD~~~----~~~~~~-~~~~~~v~~v~~~--~~~~~~~~~~~I~iwd~-~~~~~~~~l~~~~~~~~~~~~s~~~d 227 (321)
+++.-+.+.. ....+. +.+...|..+-|. +..+++++.++-..|-. +.+..+..+..... +....-|
T Consensus 90 gtvtefs~sedfnkm~~~r~~~~h~~~v~~~if~~~~e~V~s~~~dk~~~~hc~e~~~~lg~Y~~~~~-----~t~~~~d 164 (404)
T KOG1409|consen 90 GTVTEFALSEDFNKMTFLKDYLAHQARVSAIVFSLTHEWVLSTGKDKQFAWHCTESGNRLGGYNFETP-----ASALQFD 164 (404)
T ss_pred ceEEEEEhhhhhhhcchhhhhhhhhcceeeEEecCCceeEEEeccccceEEEeeccCCcccceEeecc-----CCCCcee
Confidence 6666654322 111111 1223355565554 33445555455555543 22222211111000 0001111
Q ss_pred ceEEEeecCCCCcEEEEee---CCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcE
Q 020784 228 SLVLVCPGLQKGQVRVEHY---ASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTL 293 (321)
Q Consensus 228 ~~~la~sGs~dg~V~i~d~---~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~ 293 (321)
-. .++.|...|.|.+-.+ .-..+.++++|.+.|++++|.+..++|.+|+.|.. |-+||+--++-
T Consensus 165 ~~-~~fvGd~~gqvt~lr~~~~~~~~i~~~~~h~~~~~~l~Wd~~~~~LfSg~~d~~-vi~wdigg~~g 231 (404)
T KOG1409|consen 165 AL-YAFVGDHSGQITMLKLEQNGCQLITTFNGHTGEVTCLKWDPGQRLLFSGASDHS-VIMWDIGGRKG 231 (404)
T ss_pred eE-EEEecccccceEEEEEeecCCceEEEEcCcccceEEEEEcCCCcEEEeccccCc-eEEEeccCCcc
Confidence 11 3445888888877333 33557799999999999999999999999999999 88999975543
No 314
>KOG2314 consensus Translation initiation factor 3, subunit b (eIF-3b) [Translation, ribosomal structure and biogenesis]
Probab=97.60 E-value=0.011 Score=55.93 Aligned_cols=222 Identities=13% Similarity=0.156 Sum_probs=124.3
Q ss_pred EEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEE
Q 020784 90 HISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCI 169 (321)
Q Consensus 90 ~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~ 169 (321)
-..||-|++++|.-..+++.||+...+..+-.+.. .-.+|...+|++.++++|--+-..+ -....+.+-.+-+++.+
T Consensus 310 ~frWS~DdKy~Arm~~~sisIyEtpsf~lld~Ksl-ki~gIr~FswsP~~~llAYwtpe~~--~~parvtL~evPs~~~i 386 (698)
T KOG2314|consen 310 IFRWSHDDKYFARMTGNSISIYETPSFMLLDKKSL-KISGIRDFSWSPTSNLLAYWTPETN--NIPARVTLMEVPSKREI 386 (698)
T ss_pred eEEeccCCceeEEeccceEEEEecCceeeeccccc-CCccccCcccCCCcceEEEEccccc--CCcceEEEEecCcccee
Confidence 46899999999988889999999877665444443 2356777788888887775543321 12345666666665555
Q ss_pred EEEeeCCceeE--EEEeC--CeEEEEEC-----------CEEEEEEcCCcEE-EEEEeccCCCCceEEEeeCCCceE-EE
Q 020784 170 GELSFRSEVRS--VKLRR--DRIIVVLE-----------QKIFVYNFADLKL-LHQIETIANPKGLCAVSQGVGSLV-LV 232 (321)
Q Consensus 170 ~~~~~~~~v~~--v~~~~--~~~~~~~~-----------~~I~iwd~~~~~~-~~~l~~~~~~~~~~~~s~~~d~~~-la 232 (321)
++.... .|.. +.|.. +.+++-.+ ..+.|+.++..+. +-.+... ..+++|.+.|.|.- .+
T Consensus 387 Rt~nlf-nVsDckLhWQk~gdyLcvkvdR~tK~~~~g~f~n~eIfrireKdIpve~velk---e~vi~FaWEP~gdkF~v 462 (698)
T KOG2314|consen 387 RTKNLF-NVSDCKLHWQKSGDYLCVKVDRHTKSKVKGQFSNLEIFRIREKDIPVEVVELK---ESVIAFAWEPHGDKFAV 462 (698)
T ss_pred eeccce-eeeccEEEeccCCcEEEEEEEeeccccccceEeeEEEEEeeccCCCceeeecc---hheeeeeeccCCCeEEE
Confidence 443322 1222 33322 23333221 1344444432221 1112111 23555655554433 33
Q ss_pred eecCCC-CcEEEEeeCCcc-----eEEeeccccceeEEEECCCCCEEEEE---eCCCcEEEEEEcCCCcEEEEEeCCCcc
Q 020784 233 CPGLQK-GQVRVEHYASKR-----TKFIMAHDSRIACFALTQDGQLLATS---STKGTLVRIFNTLDGTLLQEECCPSIS 303 (321)
Q Consensus 233 ~sGs~d-g~V~i~d~~~~~-----~~~l~~H~~~V~~vafspdg~~las~---S~Dgt~IrIWd~~tg~~i~~~~~g~~~ 303 (321)
++|... .++.+|...+.. ++.|.. ...+.|-|+|.|++++.+ |..|. +...|+.-..+..+-...|..
T Consensus 463 i~g~~~k~tvsfY~~e~~~~~~~lVk~~dk--~~~N~vfwsPkG~fvvva~l~s~~g~-l~F~D~~~a~~k~~~~~eh~~ 539 (698)
T KOG2314|consen 463 ISGNTVKNTVSFYAVETNIKKPSLVKELDK--KFANTVFWSPKGRFVVVAALVSRRGD-LEFYDTDYADLKDTASPEHFA 539 (698)
T ss_pred EEccccccceeEEEeecCCCchhhhhhhcc--cccceEEEcCCCcEEEEEEecccccc-eEEEecchhhhhhccCccccc
Confidence 345443 367777665321 123333 557899999999998775 55677 889998743333222222322
Q ss_pred -eeEEEeecCceEEEeecC
Q 020784 304 -AQSGLWLSSAWLRVLRTL 321 (321)
Q Consensus 304 -~~~~~s~d~~~la~~~~~ 321 (321)
..+-.-++|+|+.+++++
T Consensus 540 at~veWDPtGRYvvT~ss~ 558 (698)
T KOG2314|consen 540 ATEVEWDPTGRYVVTSSSS 558 (698)
T ss_pred cccceECCCCCEEEEeeeh
Confidence 233556888998887653
No 315
>KOG1334 consensus WD40 repeat protein [General function prediction only]
Probab=97.55 E-value=0.00031 Score=64.99 Aligned_cols=156 Identities=15% Similarity=0.098 Sum_probs=104.9
Q ss_pred cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEee--CCceeEEEEeC---CeEEEE--ECCEEEE
Q 020784 126 RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSF--RSEVRSVKLRR---DRIIVV--LEQKIFV 198 (321)
Q Consensus 126 ~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~--~~~v~~v~~~~---~~~~~~--~~~~I~i 198 (321)
|.|.+..|.+...+..++..+ +|..|.+||...+.....+.. ...|.+-.|-+ +.-++. -++++|+
T Consensus 141 H~GcVntV~FN~~Gd~l~SgS-------DD~~vv~WdW~~~~~~l~f~SGH~~NvfQaKFiP~s~d~ti~~~s~dgqvr~ 213 (559)
T KOG1334|consen 141 HKGCVNTVHFNQRGDVLASGS-------DDLQVVVWDWVSGSPKLSFESGHCNNVFQAKFIPFSGDRTIVTSSRDGQVRV 213 (559)
T ss_pred CCCccceeeecccCceeeccC-------ccceEEeehhhccCcccccccccccchhhhhccCCCCCcCceeccccCceee
Confidence 577788888777777766655 689999999988876555532 23566655654 333332 3578888
Q ss_pred EEcC-CcEE--EEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc----eEEeecccc---ceeEEEECC
Q 020784 199 YNFA-DLKL--LHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR----TKFIMAHDS---RIACFALTQ 268 (321)
Q Consensus 199 wd~~-~~~~--~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~----~~~l~~H~~---~V~~vafsp 268 (321)
=.+. ++.. .+.+..|.+++..+++-++.-..++ +++.|+.|.-.|+.... +..-..+.. ...+++..|
T Consensus 214 s~i~~t~~~e~t~rl~~h~g~vhklav~p~sp~~f~--S~geD~~v~~~Dlr~~~pa~~~~cr~~~~~~~v~L~~Ia~~P 291 (559)
T KOG1334|consen 214 SEILETGYVENTKRLAPHEGPVHKLAVEPDSPKPFL--SCGEDAVVFHIDLRQDVPAEKFVCREADEKERVGLYTIAVDP 291 (559)
T ss_pred eeeccccceecceecccccCccceeeecCCCCCccc--ccccccceeeeeeccCCccceeeeeccCCccceeeeeEecCC
Confidence 7763 3322 2334557777777887776555555 57889988877766432 222333444 468899998
Q ss_pred CCC-EEEEEeCCCcEEEEEEcCCC
Q 020784 269 DGQ-LLATSSTKGTLVRIFNTLDG 291 (321)
Q Consensus 269 dg~-~las~S~Dgt~IrIWd~~tg 291 (321)
... +||+|+.|.- +||+|.+.-
T Consensus 292 ~nt~~faVgG~dqf-~RvYD~R~~ 314 (559)
T KOG1334|consen 292 RNTNEFAVGGSDQF-ARVYDQRRI 314 (559)
T ss_pred CCccccccCChhhh-hhhhcccch
Confidence 755 8999999998 999998863
No 316
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=97.43 E-value=0.056 Score=50.72 Aligned_cols=187 Identities=12% Similarity=0.067 Sum_probs=99.2
Q ss_pred CCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceE--------EE--EEecCCCeEEEEeCCCCCCCCCCcEEEEeCCC
Q 020784 97 HGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIG--------VV--EMLFRCNILALVGGGPDPQYPLNKVMIWDDHQ 165 (321)
Q Consensus 97 g~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~--------~v--~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~ 165 (321)
+..+.+++. ..+.-+|.++++.+....+ ..... .+ .....++.+.+.+ .++.+.-+|.++
T Consensus 69 ~~~vy~~~~~g~l~ald~~tG~~~W~~~~--~~~~~~~~~~~~~~~~~~~~v~~~~v~v~~-------~~g~l~ald~~t 139 (394)
T PRK11138 69 YNKVYAADRAGLVKALDADTGKEIWSVDL--SEKDGWFSKNKSALLSGGVTVAGGKVYIGS-------EKGQVYALNAED 139 (394)
T ss_pred CCEEEEECCCCeEEEEECCCCcEeeEEcC--CCcccccccccccccccccEEECCEEEEEc-------CCCEEEEEECCC
Confidence 334444444 3456777777777666554 11000 00 0011233444443 458899999999
Q ss_pred CcEEEEEeeCCceeE-EEEeCCeEEEEE-CCEEEEEEcCCcEEEEEEeccCCCC-----ceEEEeeCCCceEEEeecCCC
Q 020784 166 SRCIGELSFRSEVRS-VKLRRDRIIVVL-EQKIFVYNFADLKLLHQIETIANPK-----GLCAVSQGVGSLVLVCPGLQK 238 (321)
Q Consensus 166 ~~~~~~~~~~~~v~~-v~~~~~~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~-----~~~~~s~~~d~~~la~sGs~d 238 (321)
|+.+-..+....+.+ -....+.+++.. ++.+..+|..+++.+.++....... ..-.+. ++.+++ ++.+
T Consensus 140 G~~~W~~~~~~~~~ssP~v~~~~v~v~~~~g~l~ald~~tG~~~W~~~~~~~~~~~~~~~sP~v~---~~~v~~--~~~~ 214 (394)
T PRK11138 140 GEVAWQTKVAGEALSRPVVSDGLVLVHTSNGMLQALNESDGAVKWTVNLDVPSLTLRGESAPATA---FGGAIV--GGDN 214 (394)
T ss_pred CCCcccccCCCceecCCEEECCEEEEECCCCEEEEEEccCCCEeeeecCCCCcccccCCCCCEEE---CCEEEE--EcCC
Confidence 998777666554433 223455566654 4689999999999988876531110 111111 123333 5667
Q ss_pred CcEEEEeeCCcceE-Eeeccc----c---ceeEEEECC--CCCEEEEEeCCCcEEEEEEcCCCcEEEEEe
Q 020784 239 GQVRVEHYASKRTK-FIMAHD----S---RIACFALTQ--DGQLLATSSTKGTLVRIFNTLDGTLLQEEC 298 (321)
Q Consensus 239 g~V~i~d~~~~~~~-~l~~H~----~---~V~~vafsp--dg~~las~S~Dgt~IrIWd~~tg~~i~~~~ 298 (321)
|.+...|..++... ...... . ....+.-+| .+..+..++.+|. +.-+|+.+|+.+-+..
T Consensus 215 g~v~a~d~~~G~~~W~~~~~~~~~~~~~~~~~~~~~sP~v~~~~vy~~~~~g~-l~ald~~tG~~~W~~~ 283 (394)
T PRK11138 215 GRVSAVLMEQGQLIWQQRISQPTGATEIDRLVDVDTTPVVVGGVVYALAYNGN-LVALDLRSGQIVWKRE 283 (394)
T ss_pred CEEEEEEccCChhhheeccccCCCccchhcccccCCCcEEECCEEEEEEcCCe-EEEEECCCCCEEEeec
Confidence 77766666554432 111000 0 001111122 1334555666787 8888888888765543
No 317
>PF08553 VID27: VID27 cytoplasmic protein; InterPro: IPR013863 This entry represents fungal and plant proteins and contains many hypothetical proteins. Vid27p is a cytoplasmic protein of unknown function, possibly regulates import of fructose-1,6-bisphosphatase into Vacuolar Import and Degradation (Vid) vesicles and is not essential for proteasome-dependent degradation of fructose-1,6-bisphosphatase (FBPase) [, ].
Probab=97.42 E-value=0.0062 Score=61.26 Aligned_cols=132 Identities=17% Similarity=0.262 Sum_probs=89.3
Q ss_pred CCCcEEEEeCCCCcEEEEEeeCCc--eeEEEEe-------CCeEEEE-ECCEEEEEEcCCc--EEEEE-EeccCCCCceE
Q 020784 154 PLNKVMIWDDHQSRCIGELSFRSE--VRSVKLR-------RDRIIVV-LEQKIFVYNFADL--KLLHQ-IETIANPKGLC 220 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~~~~~~~~--v~~v~~~-------~~~~~~~-~~~~I~iwd~~~~--~~~~~-l~~~~~~~~~~ 220 (321)
..+.|.-.|++.|+.+.+.+.+.. |..++-. +...+++ .++.+..||.|-. +++.. .+.-.......
T Consensus 502 ~~~~ly~mDLe~GKVV~eW~~~~~~~v~~~~p~~K~aqlt~e~tflGls~n~lfriDpR~~~~k~v~~~~k~Y~~~~~Fs 581 (794)
T PF08553_consen 502 NPNKLYKMDLERGKVVEEWKVHDDIPVVDIAPDSKFAQLTNEQTFLGLSDNSLFRIDPRLSGNKLVDSQSKQYSSKNNFS 581 (794)
T ss_pred CCCceEEEecCCCcEEEEeecCCCcceeEecccccccccCCCceEEEECCCceEEeccCCCCCceeeccccccccCCCce
Confidence 458899999999999999988764 4444332 2344555 4579999999742 33321 11111222345
Q ss_pred EEeeCCCceEEEeecCCCCcEEEEeeCCcceE-EeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcC
Q 020784 221 AVSQGVGSLVLVCPGLQKGQVRVEHYASKRTK-FIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 221 ~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~-~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~ 289 (321)
|++...+|.+.+ |+.+|.||++|...+..+ .|.+-..+|..|..+.||++++..+ +.. +-+.++.
T Consensus 582 ~~aTt~~G~iav--gs~~G~IRLyd~~g~~AKT~lp~lG~pI~~iDvt~DGkwilaTc-~ty-LlLi~t~ 647 (794)
T PF08553_consen 582 CFATTEDGYIAV--GSNKGDIRLYDRLGKRAKTALPGLGDPIIGIDVTADGKWILATC-KTY-LLLIDTL 647 (794)
T ss_pred EEEecCCceEEE--EeCCCcEEeecccchhhhhcCCCCCCCeeEEEecCCCcEEEEee-cce-EEEEEEe
Confidence 566666766554 999999999886544444 5678889999999999999876555 555 6688763
No 318
>PF07433 DUF1513: Protein of unknown function (DUF1513); InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=97.42 E-value=0.053 Score=48.49 Aligned_cols=181 Identities=17% Similarity=0.219 Sum_probs=106.4
Q ss_pred EEEcCCCCEEEEEcC-----CcEE-EEEec-CCceeEEeeeecCCceE--EEEEecCCCeEEEEeCCCCCCC--------
Q 020784 91 ISFNQDHGCFAAGTD-----HGFR-IYNCD-PFREIFRRDFERGGGIG--VVEMLFRCNILALVGGGPDPQY-------- 153 (321)
Q Consensus 91 v~fs~dg~~lasg~~-----~gv~-vw~~~-~~~~~~~~~~~~~~~v~--~v~~~~~~~~~~~~sg~~~~~~-------- 153 (321)
..||+||++|.+.=+ .|+. |||.. ..+.+-.+. .+.|. -+.+.+++..|+++-||=.+.=
T Consensus 56 g~fs~dG~~LytTEnd~~~g~G~IgVyd~~~~~~ri~E~~---s~GIGPHel~l~pDG~tLvVANGGI~Thpd~GR~kLN 132 (305)
T PF07433_consen 56 GVFSPDGRLLYTTENDYETGRGVIGVYDAARGYRRIGEFP---SHGIGPHELLLMPDGETLVVANGGIETHPDSGRAKLN 132 (305)
T ss_pred EEEcCCCCEEEEeccccCCCcEEEEEEECcCCcEEEeEec---CCCcChhhEEEcCCCCEEEEEcCCCccCcccCceecC
Confidence 789999999887532 4555 99998 555544443 33343 2345788888888877653321
Q ss_pred ---CCCcEEEEeCCCCcEEEEEee----C-CceeEEEEeCCeEEEEE-C---------CEEEEEEcCCcEEEEEEec---
Q 020784 154 ---PLNKVMIWDDHQSRCIGELSF----R-SEVRSVKLRRDRIIVVL-E---------QKIFVYNFADLKLLHQIET--- 212 (321)
Q Consensus 154 ---~d~~v~iWD~~~~~~~~~~~~----~-~~v~~v~~~~~~~~~~~-~---------~~I~iwd~~~~~~~~~l~~--- 212 (321)
.+-.+..-|..+|+.+....+ + -++.-+++..+..+... + --|-+++-. +.++-+..
T Consensus 133 l~tM~psL~~ld~~sG~ll~q~~Lp~~~~~lSiRHLa~~~~G~V~~a~Q~qg~~~~~~PLva~~~~g--~~~~~~~~p~~ 210 (305)
T PF07433_consen 133 LDTMQPSLVYLDARSGALLEQVELPPDLHQLSIRHLAVDGDGTVAFAMQYQGDPGDAPPLVALHRRG--GALRLLPAPEE 210 (305)
T ss_pred hhhcCCceEEEecCCCceeeeeecCccccccceeeEEecCCCcEEEEEecCCCCCccCCeEEEEcCC--CcceeccCChH
Confidence 123366677888888776554 2 25777888777655442 1 134444332 22333322
Q ss_pred ----cCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCc
Q 020784 213 ----IANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGT 281 (321)
Q Consensus 213 ----~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt 281 (321)
-.++++.+++ +.++.+++++.=..|.+.+||..++.+..... -..+-.|+-.+++ +++|.+ .|.
T Consensus 211 ~~~~l~~Y~gSIa~--~~~g~~ia~tsPrGg~~~~~d~~tg~~~~~~~-l~D~cGva~~~~~-f~~ssG-~G~ 278 (305)
T PF07433_consen 211 QWRRLNGYIGSIAA--DRDGRLIAVTSPRGGRVAVWDAATGRLLGSVP-LPDACGVAPTDDG-FLVSSG-QGQ 278 (305)
T ss_pred HHHhhCCceEEEEE--eCCCCEEEEECCCCCEEEEEECCCCCEeeccc-cCceeeeeecCCc-eEEeCC-Ccc
Confidence 1233444444 45557777666667788889988876543321 2345667777766 566554 454
No 319
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=97.41 E-value=0.05 Score=51.02 Aligned_cols=182 Identities=10% Similarity=-0.009 Sum_probs=97.9
Q ss_pred EEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEE--Eec--CCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEee
Q 020784 100 FAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVE--MLF--RCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSF 174 (321)
Q Consensus 100 lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~--~~~--~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~ 174 (321)
+..+.. +.+.-+|.++++.+..... ........ ..+ ....+.+.+ .++.+...|.++|+.+-....
T Consensus 163 v~v~~~~g~l~ald~~tG~~~W~~~~--~~~~~~~~~~~sP~v~~~~v~~~~-------~~g~v~a~d~~~G~~~W~~~~ 233 (394)
T PRK11138 163 VLVHTSNGMLQALNESDGAVKWTVNL--DVPSLTLRGESAPATAFGGAIVGG-------DNGRVSAVLMEQGQLIWQQRI 233 (394)
T ss_pred EEEECCCCEEEEEEccCCCEeeeecC--CCCcccccCCCCCEEECCEEEEEc-------CCCEEEEEEccCChhhheecc
Confidence 333444 4466778888877665543 11100000 000 122333333 357788888888876554432
Q ss_pred CCc-----------e-eEEEEeCCeEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcE
Q 020784 175 RSE-----------V-RSVKLRRDRIIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQV 241 (321)
Q Consensus 175 ~~~-----------v-~~v~~~~~~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V 241 (321)
... + ..-.+..+.++++. ++.+..+|..+++.+.+...... . ... .. ++.+++ ++.+|.+
T Consensus 234 ~~~~~~~~~~~~~~~~~sP~v~~~~vy~~~~~g~l~ald~~tG~~~W~~~~~~~-~-~~~--~~-~~~vy~--~~~~g~l 306 (394)
T PRK11138 234 SQPTGATEIDRLVDVDTTPVVVGGVVYALAYNGNLVALDLRSGQIVWKREYGSV-N-DFA--VD-GGRIYL--VDQNDRV 306 (394)
T ss_pred ccCCCccchhcccccCCCcEEECCEEEEEEcCCeEEEEECCCCCEEEeecCCCc-c-CcE--EE-CCEEEE--EcCCCeE
Confidence 111 0 11112345555554 57999999999987766543211 1 111 12 224443 4677888
Q ss_pred EEEeeCCcceE-Eeecc-ccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCC
Q 020784 242 RVEHYASKRTK-FIMAH-DSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCP 300 (321)
Q Consensus 242 ~i~d~~~~~~~-~l~~H-~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g 300 (321)
...|..++... ....- .....+.++ .+.+|..++.||. |.+.|..+|+.+.+++.+
T Consensus 307 ~ald~~tG~~~W~~~~~~~~~~~sp~v--~~g~l~v~~~~G~-l~~ld~~tG~~~~~~~~~ 364 (394)
T PRK11138 307 YALDTRGGVELWSQSDLLHRLLTAPVL--YNGYLVVGDSEGY-LHWINREDGRFVAQQKVD 364 (394)
T ss_pred EEEECCCCcEEEcccccCCCcccCCEE--ECCEEEEEeCCCE-EEEEECCCCCEEEEEEcC
Confidence 88777665433 11110 111222222 2455667888999 999999999999887654
No 320
>PF05096 Glu_cyclase_2: Glutamine cyclotransferase; InterPro: IPR007788 This family of enzymes 2.3.2.5 from EC catalyse the cyclization of free L-glutamine and N-terminal glutaminyl residues in proteins to pyroglutamate (5-oxoproline) and pyroglutamyl residues respectively []. This family includes plant and bacterial enzymes and seems unrelated to the mammalian enzymes.; PDB: 3NOK_B 2FAW_A 2IWA_A 3NOM_A 3NOL_A 3MBR_X.
Probab=97.41 E-value=0.077 Score=46.48 Aligned_cols=118 Identities=11% Similarity=0.133 Sum_probs=77.5
Q ss_pred CCeEEEEEcCCCCEEEEEcC-C--cEEEEEecCCceeEEeeeecCCce--EEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 86 PTLLHISFNQDHGCFAAGTD-H--GFRIYNCDPFREIFRRDFERGGGI--GVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~-~--gv~vw~~~~~~~~~~~~~~~~~~v--~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
.-...+.|..||.++-+.+. + .++.+|+++++......+ .... ..+... ++.+...+. ..+...+
T Consensus 45 aFTQGL~~~~~g~LyESTG~yG~S~l~~~d~~tg~~~~~~~l--~~~~FgEGit~~--~d~l~qLTW------k~~~~f~ 114 (264)
T PF05096_consen 45 AFTQGLEFLDDGTLYESTGLYGQSSLRKVDLETGKVLQSVPL--PPRYFGEGITIL--GDKLYQLTW------KEGTGFV 114 (264)
T ss_dssp -EEEEEEEEETTEEEEEECSTTEEEEEEEETTTSSEEEEEE---TTT--EEEEEEE--TTEEEEEES------SSSEEEE
T ss_pred ccCccEEecCCCEEEEeCCCCCcEEEEEEECCCCcEEEEEEC--CccccceeEEEE--CCEEEEEEe------cCCeEEE
Confidence 34567888778877766555 3 378999999987666655 2211 112221 344555553 4699999
Q ss_pred EeCCCCcEEEEEeeCCceeEEEEeCCeEEEEEC-CEEEEEEcCCcEEEEEEecc
Q 020784 161 WDDHQSRCIGELSFRSEVRSVKLRRDRIIVVLE-QKIFVYNFADLKLLHQIETI 213 (321)
Q Consensus 161 WD~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~-~~I~iwd~~~~~~~~~l~~~ 213 (321)
||.++.+.+.++....+-..++...+.++...+ .+++++|..+.+.++++.-.
T Consensus 115 yd~~tl~~~~~~~y~~EGWGLt~dg~~Li~SDGS~~L~~~dP~~f~~~~~i~V~ 168 (264)
T PF05096_consen 115 YDPNTLKKIGTFPYPGEGWGLTSDGKRLIMSDGSSRLYFLDPETFKEVRTIQVT 168 (264)
T ss_dssp EETTTTEEEEEEE-SSS--EEEECSSCEEEE-SSSEEEEE-TTT-SEEEEEE-E
T ss_pred EccccceEEEEEecCCcceEEEcCCCEEEEECCccceEEECCcccceEEEEEEE
Confidence 999999999999998888889977777666643 59999999988888877643
No 321
>KOG1645 consensus RING-finger-containing E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=97.39 E-value=0.0071 Score=55.05 Aligned_cols=228 Identities=11% Similarity=0.020 Sum_probs=117.0
Q ss_pred cCCCCCCeEEEEEcCCCC-EEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcE
Q 020784 81 SSSPPPTLLHISFNQDHG-CFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~-~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
..++...|+.++|+|... +|..++- +.+.|.|+++......... ...+-.++|.-+....+-+|. ..|.|
T Consensus 189 lp~~g~~IrdlafSp~~~GLl~~asl~nkiki~dlet~~~vssy~a--~~~~wSC~wDlde~h~IYaGl------~nG~V 260 (463)
T KOG1645|consen 189 LPGEGSFIRDLAFSPFNEGLLGLASLGNKIKIMDLETSCVVSSYIA--YNQIWSCCWDLDERHVIYAGL------QNGMV 260 (463)
T ss_pred ccccchhhhhhccCccccceeeeeccCceEEEEecccceeeeheec--cCCceeeeeccCCcceeEEec------cCceE
Confidence 356677999999999877 5666665 6688999998877665554 456777777666655555542 46999
Q ss_pred EEEeCCCCc-EEEEEeeC---CceeEEE-------EeCCeEEEEECCEEEEEEcCC--cEEEEEEeccCCCCceEEEeeC
Q 020784 159 MIWDDHQSR-CIGELSFR---SEVRSVK-------LRRDRIIVVLEQKIFVYNFAD--LKLLHQIETIANPKGLCAVSQG 225 (321)
Q Consensus 159 ~iWD~~~~~-~~~~~~~~---~~v~~v~-------~~~~~~~~~~~~~I~iwd~~~--~~~~~~l~~~~~~~~~~~~s~~ 225 (321)
.|+|++..+ .+.++... .+|..++ |....+++++.-...+|++.- ......+.. ..+..++.++.+
T Consensus 261 lvyD~R~~~~~~~e~~a~~t~~pv~~i~~~~~n~~f~~gglLv~~lt~l~f~ei~~s~~~~p~vlel-e~pG~cismqy~ 339 (463)
T KOG1645|consen 261 LVYDMRQPEGPLMELVANVTINPVHKIAPVQPNKIFTSGGLLVFALTVLQFYEIVFSAECLPCVLEL-EPPGICISMQYH 339 (463)
T ss_pred EEEEccCCCchHhhhhhhhccCcceeecccCccccccccceEEeeehhhhhhhhhccccCCCccccc-CCCcceeeeeec
Confidence 999998654 22232221 1333332 222456666655666776621 111111111 122234444444
Q ss_pred CCc-eEEEeecCCCC------cE--EEEeeCCcce-EEeecc-ccc------eeEEEECCCCCEEEEEeCCCcEEEEEEc
Q 020784 226 VGS-LVLVCPGLQKG------QV--RVEHYASKRT-KFIMAH-DSR------IACFALTQDGQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 226 ~d~-~~la~sGs~dg------~V--~i~d~~~~~~-~~l~~H-~~~------V~~vafspdg~~las~S~Dgt~IrIWd~ 288 (321)
+-. .+|+ +-..+. .| ++.+.....+ ..-..| .++ =..+.=.++..+++..+.+...+.+||.
T Consensus 340 ~~snh~l~-tyRs~pn~p~~r~il~~~d~~dG~pVc~~r~~~~Gs~~~kl~t~~ai~~~~~nn~iv~~gd~tn~lil~D~ 418 (463)
T KOG1645|consen 340 GVSNHLLL-TYRSNPNFPQSRFILGRIDFRDGFPVCGKRRTYFGSKQTKLSTTQAIRAVEDNNYIVVVGDSTNELILQDP 418 (463)
T ss_pred CccceEEE-EecCCCCCccceeeeeeeccccCceeeeecccccCCcccccccccceeccccccEEEEecCCcceeEEecc
Confidence 321 1222 111100 00 1111101111 011111 000 0112223455666655545444999999
Q ss_pred CCCcEEEEEeCCCcceeEEEe--ecCceEEEe
Q 020784 289 LDGTLLQEECCPSISAQSGLW--LSSAWLRVL 318 (321)
Q Consensus 289 ~tg~~i~~~~~g~~~~~~~~s--~d~~~la~~ 318 (321)
.+++.++++........+... .-+.|||+.
T Consensus 419 ~s~evvQ~l~~~epv~Dicp~~~n~~syLa~L 450 (463)
T KOG1645|consen 419 HSFEVVQTLALSEPVLDICPNDTNGSSYLALL 450 (463)
T ss_pred chhheeeecccCcceeecceeecCCcchhhhe
Confidence 999999998654333333222 234677764
No 322
>KOG1920 consensus IkappaB kinase complex, IKAP component [Transcription]
Probab=97.37 E-value=0.031 Score=57.55 Aligned_cols=193 Identities=15% Similarity=0.124 Sum_probs=115.8
Q ss_pred CCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEe--
Q 020784 86 PTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWD-- 162 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD-- 162 (321)
..|.++.|-.|+.-+..+...| +.+-|.++......-.. +.+|.+++|+++...++++++.. ++.+-+
T Consensus 69 ~~i~s~~fl~d~~~i~v~~~~G~iilvd~et~~~eivg~v--d~GI~aaswS~Dee~l~liT~~~-------tll~mT~~ 139 (1265)
T KOG1920|consen 69 DEIVSVQFLADTNSICVITALGDIILVDPETLELEIVGNV--DNGISAASWSPDEELLALITGRQ-------TLLFMTKD 139 (1265)
T ss_pred cceEEEEEecccceEEEEecCCcEEEEcccccceeeeeec--cCceEEEeecCCCcEEEEEeCCc-------EEEEEecc
Confidence 5899999999988777776644 66668777765544443 67899999999999999999653 332221
Q ss_pred ---------------------CCCCcEEEEEe----------------------eCCceeEEEEeCCe--EEEE-----E
Q 020784 163 ---------------------DHQSRCIGELS----------------------FRSEVRSVKLRRDR--IIVV-----L 192 (321)
Q Consensus 163 ---------------------~~~~~~~~~~~----------------------~~~~v~~v~~~~~~--~~~~-----~ 192 (321)
+.-|+.-..|. .+..=++|+|-.+. +++. .
T Consensus 140 f~~i~E~~L~~d~~~~sk~v~VGwGrkeTqfrgs~gr~~~~~~~~~ek~~~~~~~~~~~~~IsWRgDg~~fAVs~~~~~~ 219 (1265)
T KOG1920|consen 140 FEPIAEKPLDADDERKSKFVNVGWGRKETQFRGSEGRQAARQKIEKEKALEQIEQDDHKTSISWRGDGEYFAVSFVESET 219 (1265)
T ss_pred ccchhccccccccccccccceecccccceeeecchhhhcccccccccccccchhhccCCceEEEccCCcEEEEEEEeccC
Confidence 00011000111 11122347776654 4432 2
Q ss_pred C-CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeec--CCCCcEEEEeeCCcc---eE-EeeccccceeEEE
Q 020784 193 E-QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPG--LQKGQVRVEHYASKR---TK-FIMAHDSRIACFA 265 (321)
Q Consensus 193 ~-~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sG--s~dg~V~i~d~~~~~---~~-~l~~H~~~V~~va 265 (321)
+ .+|++||-. +.+- ... .......-++++.|.|.++|+.. ..|+.|.++..+.-. .. -+..-...|..++
T Consensus 220 ~~RkirV~drE-g~Ln-s~s-e~~~~l~~~LsWkPsgs~iA~iq~~~sd~~IvffErNGL~hg~f~l~~p~de~~ve~L~ 296 (1265)
T KOG1920|consen 220 GTRKIRVYDRE-GALN-STS-EPVEGLQHSLSWKPSGSLIAAIQCKTSDSDIVFFERNGLRHGEFVLPFPLDEKEVEELA 296 (1265)
T ss_pred CceeEEEeccc-chhh-ccc-CcccccccceeecCCCCeEeeeeecCCCCcEEEEecCCccccccccCCcccccchheee
Confidence 4 699999976 4331 111 11122234556666777877533 335567776654321 11 1223334499999
Q ss_pred ECCCCCEEEE---EeCCCcEEEEEEcCCC
Q 020784 266 LTQDGQLLAT---SSTKGTLVRIFNTLDG 291 (321)
Q Consensus 266 fspdg~~las---~S~Dgt~IrIWd~~tg 291 (321)
|+.++..||+ ..... .|++|-+.+.
T Consensus 297 Wns~sdiLAv~~~~~e~~-~v~lwt~~Ny 324 (1265)
T KOG1920|consen 297 WNSNSDILAVVTSNLENS-LVQLWTTGNY 324 (1265)
T ss_pred ecCCCCceeeeecccccc-eEEEEEecCe
Confidence 9999999998 44444 4999988764
No 323
>KOG1275 consensus PAB-dependent poly(A) ribonuclease, subunit PAN2 [Replication, recombination and repair]
Probab=97.31 E-value=0.0019 Score=64.24 Aligned_cols=147 Identities=16% Similarity=0.150 Sum_probs=98.7
Q ss_pred CCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCC--CCCCCCCcEEEEeCCCCcEEEE
Q 020784 95 QDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGP--DPQYPLNKVMIWDDHQSRCIGE 171 (321)
Q Consensus 95 ~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~--~~~~~d~~v~iWD~~~~~~~~~ 171 (321)
.++++|.+|...| |.+-|..+.+.+..... |.+.+.. +.-.+|+++++|-+. .....|.-|+|||+++.+.+.-
T Consensus 185 ~Nnr~lf~G~t~G~V~LrD~~s~~~iht~~a-Hs~siSD--fDv~GNlLitCG~S~R~~~l~~D~FvkVYDLRmmral~P 261 (1118)
T KOG1275|consen 185 YNNRNLFCGDTRGTVFLRDPNSFETIHTFDA-HSGSISD--FDVQGNLLITCGYSMRRYNLAMDPFVKVYDLRMMRALSP 261 (1118)
T ss_pred ecCcEEEeecccceEEeecCCcCceeeeeec-cccceee--eeccCCeEEEeecccccccccccchhhhhhhhhhhccCC
Confidence 4678888998855 77989988888777665 5555554 455789998887433 2344577899999999888777
Q ss_pred EeeCCceeEEEEeCC---eEEEEE-CCEEEEEEc---CCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEE
Q 020784 172 LSFRSEVRSVKLRRD---RIIVVL-EQKIFVYNF---ADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVE 244 (321)
Q Consensus 172 ~~~~~~v~~v~~~~~---~~~~~~-~~~I~iwd~---~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~ 244 (321)
+.++....-+.|+|. ++++++ .++..+-|. .+-. ...+.-+....++.+|...+++..+|+ |..+|.|.+|
T Consensus 262 I~~~~~P~flrf~Psl~t~~~V~S~sGq~q~vd~~~lsNP~-~~~~~v~p~~s~i~~fDiSsn~~alaf-gd~~g~v~~w 339 (1118)
T KOG1275|consen 262 IQFPYGPQFLRFHPSLTTRLAVTSQSGQFQFVDTATLSNPP-AGVKMVNPNGSGISAFDISSNGDALAF-GDHEGHVNLW 339 (1118)
T ss_pred cccccCchhhhhcccccceEEEEecccceeeccccccCCCc-cceeEEccCCCcceeEEecCCCceEEE-ecccCcEeee
Confidence 777766666777764 466664 468888773 2221 122222222223444444445588887 9999999999
Q ss_pred ee
Q 020784 245 HY 246 (321)
Q Consensus 245 d~ 246 (321)
.-
T Consensus 340 a~ 341 (1118)
T KOG1275|consen 340 AD 341 (1118)
T ss_pred cC
Confidence 73
No 324
>PF11768 DUF3312: Protein of unknown function (DUF3312); InterPro: IPR024511 This is a eukaryotic family of uncharacterised proteins that contain WD40 repeats.
Probab=97.27 E-value=0.013 Score=55.86 Aligned_cols=122 Identities=16% Similarity=0.159 Sum_probs=77.2
Q ss_pred EEEEEEcCC--cEEEEEEeccCCCCceEEEeeCCCceEEEe--ecCCCCcEEE----EeeCCcceE----Eeecccccee
Q 020784 195 KIFVYNFAD--LKLLHQIETIANPKGLCAVSQGVGSLVLVC--PGLQKGQVRV----EHYASKRTK----FIMAHDSRIA 262 (321)
Q Consensus 195 ~I~iwd~~~--~~~~~~l~~~~~~~~~~~~s~~~d~~~la~--sGs~dg~V~i----~d~~~~~~~----~l~~H~~~V~ 262 (321)
.+.+|.+.. .+.+..+.+..++ ..+.|+...+..+..+ +-+.+|.+.+ |+.....+. +--.+.+.|.
T Consensus 185 Nl~L~~~~~~klEvL~yirTE~dP-l~~~Fs~~~~~qi~tVE~s~s~~g~~~~d~ciYE~~r~klqrvsvtsipL~s~v~ 263 (545)
T PF11768_consen 185 NLHLLSCSGGKLEVLSYIRTENDP-LDVEFSLNQPYQIHTVEQSISVKGEPSADSCIYECSRNKLQRVSVTSIPLPSQVI 263 (545)
T ss_pred cEEEEEecCCcEEEEEEEEecCCc-EEEEccCCCCcEEEEEEEecCCCCCceeEEEEEEeecCceeEEEEEEEecCCcce
Confidence 455555533 3444555554444 3455665555555543 2244665554 444433222 2336788999
Q ss_pred EEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEEEee
Q 020784 263 CFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 263 ~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~~ 319 (321)
|++++|+...|+.|+.||+ |.+||..++.-... +...-...++..++|..+.|+.
T Consensus 264 ~ca~sp~E~kLvlGC~DgS-iiLyD~~~~~t~~~-ka~~~P~~iaWHp~gai~~V~s 318 (545)
T PF11768_consen 264 CCARSPSEDKLVLGCEDGS-IILYDTTRGVTLLA-KAEFIPTLIAWHPDGAIFVVGS 318 (545)
T ss_pred EEecCcccceEEEEecCCe-EEEEEcCCCeeeee-eecccceEEEEcCCCcEEEEEc
Confidence 9999999999999999999 99999988744332 2334445556778998988864
No 325
>PF08553 VID27: VID27 cytoplasmic protein; InterPro: IPR013863 This entry represents fungal and plant proteins and contains many hypothetical proteins. Vid27p is a cytoplasmic protein of unknown function, possibly regulates import of fructose-1,6-bisphosphatase into Vacuolar Import and Degradation (Vid) vesicles and is not essential for proteasome-dependent degradation of fructose-1,6-bisphosphatase (FBPase) [, ].
Probab=97.26 E-value=0.0044 Score=62.29 Aligned_cols=120 Identities=17% Similarity=0.249 Sum_probs=79.0
Q ss_pred CEEEEEEcCCcEEEEEEeccCCCCceEEEeeC-------CCceEEEeecCCCCcEEEEeeCCc--ceEE--ee--ccccc
Q 020784 194 QKIFVYNFADLKLLHQIETIANPKGLCAVSQG-------VGSLVLVCPGLQKGQVRVEHYASK--RTKF--IM--AHDSR 260 (321)
Q Consensus 194 ~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~-------~d~~~la~sGs~dg~V~i~d~~~~--~~~~--l~--~H~~~ 260 (321)
+.|+-.|+..|+.+...+.+... .+..+.++ +...++ |-.+..+.-||.+.. .+.. .+ .....
T Consensus 504 ~~ly~mDLe~GKVV~eW~~~~~~-~v~~~~p~~K~aqlt~e~tfl---Gls~n~lfriDpR~~~~k~v~~~~k~Y~~~~~ 579 (794)
T PF08553_consen 504 NKLYKMDLERGKVVEEWKVHDDI-PVVDIAPDSKFAQLTNEQTFL---GLSDNSLFRIDPRLSGNKLVDSQSKQYSSKNN 579 (794)
T ss_pred CceEEEecCCCcEEEEeecCCCc-ceeEecccccccccCCCceEE---EECCCceEEeccCCCCCceeeccccccccCCC
Confidence 58888899999999999887543 25566553 333344 444555655665532 2221 11 23456
Q ss_pred eeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeC--CCcceeEEEeecCce-EEEeec
Q 020784 261 IACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECC--PSISAQSGLWLSSAW-LRVLRT 320 (321)
Q Consensus 261 V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~--g~~~~~~~~s~d~~~-la~~~~ 320 (321)
.+|++-+.+|. ||.||.+|. ||+|| +.|+.-+|.-- |.....+..+.||+| ||+|++
T Consensus 580 Fs~~aTt~~G~-iavgs~~G~-IRLyd-~~g~~AKT~lp~lG~pI~~iDvt~DGkwilaTc~t 639 (794)
T PF08553_consen 580 FSCFATTEDGY-IAVGSNKGD-IRLYD-RLGKRAKTALPGLGDPIIGIDVTADGKWILATCKT 639 (794)
T ss_pred ceEEEecCCce-EEEEeCCCc-EEeec-ccchhhhhcCCCCCCCeeEEEecCCCcEEEEeecc
Confidence 78888888875 788999999 99999 45555455432 444555688999999 555654
No 326
>KOG3914 consensus WD repeat protein WDR4 [Function unknown]
Probab=97.25 E-value=0.0068 Score=55.00 Aligned_cols=79 Identities=18% Similarity=0.176 Sum_probs=62.8
Q ss_pred CCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceE
Q 020784 236 LQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWL 315 (321)
Q Consensus 236 s~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~l 315 (321)
+....+.+|.....+...+.||-+.++.|+|+||++++.|+-.|.. |||=.+..--.+.+|+-||...+..++.-..|+
T Consensus 129 gD~~~~di~s~~~~~~~~~lGhvSml~dVavS~D~~~IitaDRDEk-IRvs~ypa~f~IesfclGH~eFVS~isl~~~~~ 207 (390)
T KOG3914|consen 129 GDVYSFDILSADSGRCEPILGHVSMLLDVAVSPDDQFIITADRDEK-IRVSRYPATFVIESFCLGHKEFVSTISLTDNYL 207 (390)
T ss_pred CCceeeeeecccccCcchhhhhhhhhheeeecCCCCEEEEecCCce-EEEEecCcccchhhhccccHhheeeeeeccCce
Confidence 3344555565444555667899999999999999999999999999 999999988889999999998887666444443
No 327
>COG0823 TolB Periplasmic component of the Tol biopolymer transport system [Intracellular trafficking and secretion]
Probab=97.22 E-value=0.028 Score=53.17 Aligned_cols=178 Identities=8% Similarity=0.014 Sum_probs=100.8
Q ss_pred EEEEEecCCCeEEEEeCCCCCCCCC--CcEEEEeCCCCcEEEEEeeCCceeEEEEeC--CeEEEEEC--C--EEEEEEcC
Q 020784 131 GVVEMLFRCNILALVGGGPDPQYPL--NKVMIWDDHQSRCIGELSFRSEVRSVKLRR--DRIIVVLE--Q--KIFVYNFA 202 (321)
Q Consensus 131 ~~v~~~~~~~~~~~~sg~~~~~~~d--~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~--~~~~~~~~--~--~I~iwd~~ 202 (321)
..-.|++++..++...=. .. -.+.++|+++++......+...-..-.|++ ++++.+.. + .|.++|+.
T Consensus 196 ~~p~ws~~~~~~~y~~f~-----~~~~~~i~~~~l~~g~~~~i~~~~g~~~~P~fspDG~~l~f~~~rdg~~~iy~~dl~ 270 (425)
T COG0823 196 LTPAWSPDGKKLAYVSFE-----LGGCPRIYYLDLNTGKRPVILNFNGNNGAPAFSPDGSKLAFSSSRDGSPDIYLMDLD 270 (425)
T ss_pred eccccCcCCCceEEEEEe-----cCCCceEEEEeccCCccceeeccCCccCCccCCCCCCEEEEEECCCCCccEEEEcCC
Confidence 334566666665544311 11 358999999887655555555444555666 45655543 3 78888998
Q ss_pred CcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEE--EeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCC
Q 020784 203 DLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRV--EHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKG 280 (321)
Q Consensus 203 ~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i--~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dg 280 (321)
..+. ..+.........-.+ .+||..+++..+..|.=.| .+...+....+....+.-..-.|||||++||..+..+
T Consensus 271 ~~~~-~~Lt~~~gi~~~Ps~--spdG~~ivf~Sdr~G~p~I~~~~~~g~~~~riT~~~~~~~~p~~SpdG~~i~~~~~~~ 347 (425)
T COG0823 271 GKNL-PRLTNGFGINTSPSW--SPDGSKIVFTSDRGGRPQIYLYDLEGSQVTRLTFSGGGNSNPVWSPDGDKIVFESSSG 347 (425)
T ss_pred CCcc-eecccCCccccCccC--CCCCCEEEEEeCCCCCcceEEECCCCCceeEeeccCCCCcCccCCCCCCEEEEEeccC
Confidence 7764 335443333333344 4556777776677775555 5555555444443433333778999999999887543
Q ss_pred c--EEEEEEcCCCcEEEEEeCCCcceeEEEeecCceEE
Q 020784 281 T--LVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWLR 316 (321)
Q Consensus 281 t--~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~la 316 (321)
. .|-+.|+.++.-++.+........-.+++++++|.
T Consensus 348 g~~~i~~~~~~~~~~~~~lt~~~~~e~ps~~~ng~~i~ 385 (425)
T COG0823 348 GQWDIDKNDLASGGKIRILTSTYLNESPSWAPNGRMIM 385 (425)
T ss_pred CceeeEEeccCCCCcEEEccccccCCCCCcCCCCceEE
Confidence 2 25666666665444443222222224445554443
No 328
>KOG2395 consensus Protein involved in vacuole import and degradation [Intracellular trafficking, secretion, and vesicular transport]
Probab=97.20 E-value=0.0092 Score=56.28 Aligned_cols=131 Identities=18% Similarity=0.308 Sum_probs=90.2
Q ss_pred CCcEEEEeCCCCcEEEEEeeCCceeEEEEeCC---------eEEEE-ECCEEEEEEcCCc-E-EEEEEeccC--CCCceE
Q 020784 155 LNKVMIWDDHQSRCIGELSFRSEVRSVKLRRD---------RIIVV-LEQKIFVYNFADL-K-LLHQIETIA--NPKGLC 220 (321)
Q Consensus 155 d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~---------~~~~~-~~~~I~iwd~~~~-~-~~~~l~~~~--~~~~~~ 220 (321)
.+.+.-.|++.|+.+.+..++..|.-+.+.++ ..+++ .++.|+-||.+-. + .+...+.+. ......
T Consensus 355 ~~~l~klDIE~GKIVeEWk~~~di~mv~~t~d~K~~Ql~~e~TlvGLs~n~vfriDpRv~~~~kl~~~q~kqy~~k~nFs 434 (644)
T KOG2395|consen 355 QDKLYKLDIERGKIVEEWKFEDDINMVDITPDFKFAQLTSEQTLVGLSDNSVFRIDPRVQGKNKLAVVQSKQYSTKNNFS 434 (644)
T ss_pred cCcceeeecccceeeeEeeccCCcceeeccCCcchhcccccccEEeecCCceEEecccccCcceeeeeeccccccccccc
Confidence 47788999999999999998887766666654 23344 4579999998632 1 222222221 122344
Q ss_pred EEeeCCCceEEEeecCCCCcEEEEeeCCcceE-EeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcC
Q 020784 221 AVSQGVGSLVLVCPGLQKGQVRVEHYASKRTK-FIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 221 ~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~-~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~ 289 (321)
|+...++|.+++ |+.+|.|+++|......+ .|.+...+|..|..+.||++++..+ +.. +-+-++.
T Consensus 435 c~aTT~sG~Ivv--gS~~GdIRLYdri~~~AKTAlPgLG~~I~hVdvtadGKwil~Tc-~ty-LlLi~t~ 500 (644)
T KOG2395|consen 435 CFATTESGYIVV--GSLKGDIRLYDRIGRRAKTALPGLGDAIKHVDVTADGKWILATC-KTY-LLLIDTL 500 (644)
T ss_pred eeeecCCceEEE--eecCCcEEeehhhhhhhhhcccccCCceeeEEeeccCcEEEEec-ccE-EEEEEEe
Confidence 556666665554 899999999987554443 6888999999999999999876554 656 5566653
No 329
>PRK02888 nitrous-oxide reductase; Validated
Probab=97.10 E-value=0.13 Score=50.40 Aligned_cols=146 Identities=10% Similarity=0.016 Sum_probs=80.0
Q ss_pred CcEEEEeCCCCcEEEEEeeCCceeEEEEeCC--eEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeC------CC
Q 020784 156 NKVMIWDDHQSRCIGELSFRSEVRSVKLRRD--RIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQG------VG 227 (321)
Q Consensus 156 ~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~--~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~------~d 227 (321)
+.+.+.|.++.+...++........+.+.++ .+++.. ||.+.+..+..+...... .+..|... .+
T Consensus 215 ~~vSvID~etmeV~~qV~Vdgnpd~v~~spdGk~afvTs------yNsE~G~tl~em~a~e~d-~~vvfni~~iea~vkd 287 (635)
T PRK02888 215 SLFTAVDAETMEVAWQVMVDGNLDNVDTDYDGKYAFSTC------YNSEEGVTLAEMMAAERD-WVVVFNIARIEEAVKA 287 (635)
T ss_pred EEEEEEECccceEEEEEEeCCCcccceECCCCCEEEEec------cCcccCcceeeeccccCc-eEEEEchHHHHHhhhC
Confidence 4456666666666666655555555555544 233322 122222222222221111 12222221 13
Q ss_pred ceEEEeecCCCCcEEEEeeCC-----cceEEeeccccceeEEEECCCCCEEEEEeC-CCcEEEEEEcCCCc---------
Q 020784 228 SLVLVCPGLQKGQVRVEHYAS-----KRTKFIMAHDSRIACFALTQDGQLLATSST-KGTLVRIFNTLDGT--------- 292 (321)
Q Consensus 228 ~~~la~sGs~dg~V~i~d~~~-----~~~~~l~~H~~~V~~vafspdg~~las~S~-Dgt~IrIWd~~tg~--------- 292 (321)
+.+..+ + ++.|.+.|... ..+..+-.=...+..|+++|||+++..++. +.+ |-|.|+.+.+
T Consensus 288 GK~~~V-~--gn~V~VID~~t~~~~~~~v~~yIPVGKsPHGV~vSPDGkylyVanklS~t-VSVIDv~k~k~~~~~~~~~ 363 (635)
T PRK02888 288 GKFKTI-G--GSKVPVVDGRKAANAGSALTRYVPVPKNPHGVNTSPDGKYFIANGKLSPT-VTVIDVRKLDDLFDGKIKP 363 (635)
T ss_pred CCEEEE-C--CCEEEEEECCccccCCcceEEEEECCCCccceEECCCCCEEEEeCCCCCc-EEEEEChhhhhhhhccCCc
Confidence 333332 2 45788888766 233333334566889999999998777655 777 9999999866
Q ss_pred ---EEEEEeCCCcceeEEEeecC
Q 020784 293 ---LLQEECCPSISAQSGLWLSS 312 (321)
Q Consensus 293 ---~i~~~~~g~~~~~~~~s~d~ 312 (321)
++.+...|-......|..+|
T Consensus 364 ~~~vvaevevGlGPLHTaFDg~G 386 (635)
T PRK02888 364 RDAVVAEPELGLGPLHTAFDGRG 386 (635)
T ss_pred cceEEEeeccCCCcceEEECCCC
Confidence 36666666665555554444
No 330
>PF08450 SGL: SMP-30/Gluconolaconase/LRE-like region; InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=97.00 E-value=0.2 Score=43.48 Aligned_cols=146 Identities=14% Similarity=0.025 Sum_probs=90.2
Q ss_pred EEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEe--CCeEEEEECCEEEEEEcCCcEEEEEE
Q 020784 133 VEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLR--RDRIIVVLEQKIFVYNFADLKLLHQI 210 (321)
Q Consensus 133 v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~--~~~~~~~~~~~I~iwd~~~~~~~~~l 210 (321)
..|......+.++.- ..+.|..||..++... .+.... ...+.+. ...++++..+.+.++|..+++....+
T Consensus 5 p~~d~~~g~l~~~D~------~~~~i~~~~~~~~~~~-~~~~~~-~~G~~~~~~~g~l~v~~~~~~~~~d~~~g~~~~~~ 76 (246)
T PF08450_consen 5 PVWDPRDGRLYWVDI------PGGRIYRVDPDTGEVE-VIDLPG-PNGMAFDRPDGRLYVADSGGIAVVDPDTGKVTVLA 76 (246)
T ss_dssp EEEETTTTEEEEEET------TTTEEEEEETTTTEEE-EEESSS-EEEEEEECTTSEEEEEETTCEEEEETTTTEEEEEE
T ss_pred eEEECCCCEEEEEEc------CCCEEEEEECCCCeEE-EEecCC-CceEEEEccCCEEEEEEcCceEEEecCCCcEEEEe
Confidence 345553444444442 3588999999887653 344444 6666666 45677777788888899887654444
Q ss_pred ec--cC-CCCceEEEeeCCCceEEEeecCCC--------CcEEEEeeCCcceEEeeccccceeEEEECCCCCEEE-EEeC
Q 020784 211 ET--IA-NPKGLCAVSQGVGSLVLVCPGLQK--------GQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLA-TSST 278 (321)
Q Consensus 211 ~~--~~-~~~~~~~~s~~~d~~~la~sGs~d--------g~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~la-s~S~ 278 (321)
.. .. .......+..++++.+.+. .... |.|..++.. +....+...-...+.|+|+|+|+.|. +-+.
T Consensus 77 ~~~~~~~~~~~~ND~~vd~~G~ly~t-~~~~~~~~~~~~g~v~~~~~~-~~~~~~~~~~~~pNGi~~s~dg~~lyv~ds~ 154 (246)
T PF08450_consen 77 DLPDGGVPFNRPNDVAVDPDGNLYVT-DSGGGGASGIDPGSVYRIDPD-GKVTVVADGLGFPNGIAFSPDGKTLYVADSF 154 (246)
T ss_dssp EEETTCSCTEEEEEEEE-TTS-EEEE-EECCBCTTCGGSEEEEEEETT-SEEEEEEEEESSEEEEEEETTSSEEEEEETT
T ss_pred eccCCCcccCCCceEEEcCCCCEEEE-ecCCCccccccccceEEECCC-CeEEEEecCcccccceEECCcchheeecccc
Confidence 43 12 2344556666777776653 2111 446556655 44444444566789999999998665 5566
Q ss_pred CCcEEEEEEcC
Q 020784 279 KGTLVRIFNTL 289 (321)
Q Consensus 279 Dgt~IrIWd~~ 289 (321)
.+. |..+++.
T Consensus 155 ~~~-i~~~~~~ 164 (246)
T PF08450_consen 155 NGR-IWRFDLD 164 (246)
T ss_dssp TTE-EEEEEEE
T ss_pred cce-eEEEecc
Confidence 666 8888885
No 331
>PF12894 Apc4_WD40: Anaphase-promoting complex subunit 4 WD40 domain
Probab=96.89 E-value=0.0031 Score=39.90 Aligned_cols=35 Identities=20% Similarity=0.425 Sum_probs=30.7
Q ss_pred ccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEE
Q 020784 258 DSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLL 294 (321)
Q Consensus 258 ~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i 294 (321)
...|.+++|+|...+||.|+.||. |.|+.+ +++.+
T Consensus 11 ~~~v~~~~w~P~mdLiA~~t~~g~-v~v~Rl-~~qri 45 (47)
T PF12894_consen 11 PSRVSCMSWCPTMDLIALGTEDGE-VLVYRL-NWQRI 45 (47)
T ss_pred CCcEEEEEECCCCCEEEEEECCCe-EEEEEC-CCcCc
Confidence 456999999999999999999999 999998 66654
No 332
>KOG3621 consensus WD40 repeat-containing protein [General function prediction only]
Probab=96.88 E-value=0.007 Score=58.72 Aligned_cols=110 Identities=14% Similarity=0.258 Sum_probs=73.6
Q ss_pred eeEEEEeCCeEEEEEC-CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc---eEE
Q 020784 178 VRSVKLRRDRIIVVLE-QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR---TKF 253 (321)
Q Consensus 178 v~~v~~~~~~~~~~~~-~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~---~~~ 253 (321)
.++++-..+.++++++ +.+.+|+-..++. ++++.......++..+.+.+..++| .|+..|.|.|+-++... ...
T Consensus 38 lTc~dst~~~l~~GsS~G~lyl~~R~~~~~-~~~~~~~~~~~~~~~~vs~~e~lvA-agt~~g~V~v~ql~~~~p~~~~~ 115 (726)
T KOG3621|consen 38 LTCVDATEEYLAMGSSAGSVYLYNRHTGEM-RKLKNEGATGITCVRSVSSVEYLVA-AGTASGRVSVFQLNKELPRDLDY 115 (726)
T ss_pred EEEeecCCceEEEecccceEEEEecCchhh-hcccccCccceEEEEEecchhHhhh-hhcCCceEEeehhhccCCCccee
Confidence 4455666677777765 7999999766544 3333321223334444444445666 49999999996655321 111
Q ss_pred ---e-eccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 254 ---I-MAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 254 ---l-~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
+ +.|...|++++|++||..|-+|-..|+ |..-.+.+
T Consensus 116 ~t~~d~~~~~rVTal~Ws~~~~k~ysGD~~Gk-v~~~~L~s 155 (726)
T KOG3621|consen 116 VTPCDKSHKCRVTALEWSKNGMKLYSGDSQGK-VVLTELDS 155 (726)
T ss_pred eccccccCCceEEEEEecccccEEeecCCCce-EEEEEech
Confidence 1 237889999999999999999998998 87777776
No 333
>COG0823 TolB Periplasmic component of the Tol biopolymer transport system [Intracellular trafficking and secretion]
Probab=96.83 E-value=0.11 Score=49.29 Aligned_cols=121 Identities=11% Similarity=0.054 Sum_probs=73.8
Q ss_pred EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEE--EeeCCcceEEeeccccceeEEEECCCCCE
Q 020784 195 KIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRV--EHYASKRTKFIMAHDSRIACFALTQDGQL 272 (321)
Q Consensus 195 ~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i--~d~~~~~~~~l~~H~~~V~~vafspdg~~ 272 (321)
.+.++++.+++..+.+.. ......-.|++ |+..|+++...||...| .|+..+.+..+..-.+.-..=.|+|||++
T Consensus 219 ~i~~~~l~~g~~~~i~~~-~g~~~~P~fsp--DG~~l~f~~~rdg~~~iy~~dl~~~~~~~Lt~~~gi~~~Ps~spdG~~ 295 (425)
T COG0823 219 RIYYLDLNTGKRPVILNF-NGNNGAPAFSP--DGSKLAFSSSRDGSPDIYLMDLDGKNLPRLTNGFGINTSPSWSPDGSK 295 (425)
T ss_pred eEEEEeccCCccceeecc-CCccCCccCCC--CCCEEEEEECCCCCccEEEEcCCCCcceecccCCccccCccCCCCCCE
Confidence 699999988766555442 22233445555 55777777888887666 56666655444433333336678999998
Q ss_pred EEEEeCCCcEEEEE--EcCCCcEEEEEeCCCc-ceeEEEeecCceEEEee
Q 020784 273 LATSSTKGTLVRIF--NTLDGTLLQEECCPSI-SAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 273 las~S~Dgt~IrIW--d~~tg~~i~~~~~g~~-~~~~~~s~d~~~la~~~ 319 (321)
++=.|+.+..-+|| |...+.. ..+..... ...-..++||++|+...
T Consensus 296 ivf~Sdr~G~p~I~~~~~~g~~~-~riT~~~~~~~~p~~SpdG~~i~~~~ 344 (425)
T COG0823 296 IVFTSDRGGRPQIYLYDLEGSQV-TRLTFSGGGNSNPVWSPDGDKIVFES 344 (425)
T ss_pred EEEEeCCCCCcceEEECCCCCce-eEeeccCCCCcCccCCCCCCEEEEEe
Confidence 88776644335666 4444443 33322222 22447789999998764
No 334
>PF15492 Nbas_N: Neuroblastoma-amplified sequence, N terminal
Probab=96.83 E-value=0.15 Score=44.70 Aligned_cols=153 Identities=12% Similarity=0.074 Sum_probs=81.5
Q ss_pred CeEEEEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeec------CCceEEEEEecC------CCeEEEEeCCCCCCC
Q 020784 87 TLLHISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFER------GGGIGVVEMLFR------CNILALVGGGPDPQY 153 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~------~~~v~~v~~~~~------~~~~~~~sg~~~~~~ 153 (321)
.=+-++||||+.+||.+.. +.|+|||+.... ++...-.+ ...|..+.+..- ...+.++.
T Consensus 45 QWRkl~WSpD~tlLa~a~S~G~i~vfdl~g~~-lf~I~p~~~~~~d~~~Aiagl~Fl~~~~s~~ws~ELlvi~------- 116 (282)
T PF15492_consen 45 QWRKLAWSPDCTLLAYAESTGTIRVFDLMGSE-LFVIPPAMSFPGDLSDAIAGLIFLEYKKSAQWSYELLVIN------- 116 (282)
T ss_pred hheEEEECCCCcEEEEEcCCCeEEEEecccce-eEEcCcccccCCccccceeeeEeeccccccccceeEEEEe-------
Confidence 4567999999999998887 458899986432 22221100 123333333211 12333443
Q ss_pred CCCcEEEEeCC-----CCcEEEEEeeC----CceeEEEEeCC-e-EEEEEC------------CEEEEEEcCCcEEEEE-
Q 020784 154 PLNKVMIWDDH-----QSRCIGELSFR----SEVRSVKLRRD-R-IIVVLE------------QKIFVYNFADLKLLHQ- 209 (321)
Q Consensus 154 ~d~~v~iWD~~-----~~~~~~~~~~~----~~v~~v~~~~~-~-~~~~~~------------~~I~iwd~~~~~~~~~- 209 (321)
.+|.++-+-+. ..+....+.+. ..|.++.++++ + +++++. ..+..|.+-++..-.+
T Consensus 117 Y~G~L~Sy~vs~gt~q~y~e~hsfsf~~~yp~Gi~~~vy~p~h~LLlVgG~~~~~~~~s~a~~~GLtaWRiL~~~Pyyk~ 196 (282)
T PF15492_consen 117 YRGQLRSYLVSVGTNQGYQENHSFSFSSHYPHGINSAVYHPKHRLLLVGGCEQNQDGMSKASSCGLTAWRILSDSPYYKQ 196 (282)
T ss_pred ccceeeeEEEEcccCCcceeeEEEEecccCCCceeEEEEcCCCCEEEEeccCCCCCccccccccCceEEEEcCCCCcEEE
Confidence 34666666542 23344455543 35888888876 3 333321 1355665532111100
Q ss_pred --------------------E-----ec-cCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCC
Q 020784 210 --------------------I-----ET-IANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYAS 248 (321)
Q Consensus 210 --------------------l-----~~-~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~ 248 (321)
+ .. ......+..++-.||+.+||+ -+.+|.|.+|++-.
T Consensus 197 v~~~~~~~~~~~~~~~~~~~~~~~~fs~~~~~~d~i~kmSlSPdg~~La~-ih~sG~lsLW~iPs 260 (282)
T PF15492_consen 197 VTSSEDDITASSKRRGLLRIPSFKFFSRQGQEQDGIFKMSLSPDGSLLAC-IHFSGSLSLWEIPS 260 (282)
T ss_pred ccccCccccccccccceeeccceeeeeccccCCCceEEEEECCCCCEEEE-EEcCCeEEEEecCc
Confidence 0 00 111223444555567788885 89999999999754
No 335
>COG5170 CDC55 Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=96.83 E-value=0.017 Score=51.12 Aligned_cols=158 Identities=13% Similarity=0.140 Sum_probs=91.8
Q ss_pred cCCCCCCeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEe----eee---cCCceEEEEEecCCCeEEEEeCCCCCCC
Q 020784 81 SSSPPPTLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRR----DFE---RGGGIGVVEMLFRCNILALVGGGPDPQY 153 (321)
Q Consensus 81 ~~~~~~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~----~~~---~~~~v~~v~~~~~~~~~~~~sg~~~~~~ 153 (321)
...|+--|++++|+.|...+.++.+=.|-+|+++-....+.. ... -...|...++++..+.+..-+.
T Consensus 168 aNaH~yhiNSiS~NsD~et~lSaDdLrINLWnl~i~D~sFnIVDiKP~nmeeLteVItSaeFhp~~cn~fmYSs------ 241 (460)
T COG5170 168 ANAHPYHINSISFNSDKETLLSADDLRINLWNLEIIDGSFNIVDIKPHNMEELTEVITSAEFHPEMCNVFMYSS------ 241 (460)
T ss_pred cccceeEeeeeeecCchheeeeccceeeeeccccccCCceEEEeccCccHHHHHHHHhhcccCHhHcceEEEec------
Confidence 356778899999999999999987777889998644322211 100 0123445555554333333221
Q ss_pred CCCcEEEEeCCCCcE------EEEEee-----------CCceeEEEEeCCeEEEEE-C-CEEEEEEcC-CcEEEEEEecc
Q 020784 154 PLNKVMIWDDHQSRC------IGELSF-----------RSEVRSVKLRRDRIIVVL-E-QKIFVYNFA-DLKLLHQIETI 213 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~------~~~~~~-----------~~~v~~v~~~~~~~~~~~-~-~~I~iwd~~-~~~~~~~l~~~ 213 (321)
+.|+|++-|++.... +.+... -..|..+.|+++..++.. + -+|+|||.+ ...+++++..|
T Consensus 242 SkG~Ikl~DlRq~alcdn~~klfe~~~D~v~~~ff~eivsSISD~kFs~ngryIlsRdyltvkiwDvnm~k~pikTi~~h 321 (460)
T COG5170 242 SKGEIKLNDLRQSALCDNSKKLFELTIDGVDVDFFEEIVSSISDFKFSDNGRYILSRDYLTVKIWDVNMAKNPIKTIPMH 321 (460)
T ss_pred CCCcEEehhhhhhhhccCchhhhhhccCcccchhHHHHhhhhcceEEcCCCcEEEEeccceEEEEecccccCCceeechH
Confidence 469999999874321 111111 124666888887644444 4 499999995 35667776443
Q ss_pred CCC-------------CceEEEeeCCCceEEEeecCCCCcEEEEe
Q 020784 214 ANP-------------KGLCAVSQGVGSLVLVCPGLQKGQVRVEH 245 (321)
Q Consensus 214 ~~~-------------~~~~~~s~~~d~~~la~sGs~dg~V~i~d 245 (321)
..- ..-..+++.+|..-+. +|+.....-|+-
T Consensus 322 ~~l~~~l~d~YEnDaifdkFeisfSgd~~~v~-sgsy~NNfgiyp 365 (460)
T COG5170 322 CDLMDELNDVYENDAIFDKFEISFSGDDKHVL-SGSYSNNFGIYP 365 (460)
T ss_pred HHHHHHHHhhhhccceeeeEEEEecCCccccc-ccccccceeeec
Confidence 210 1123345555544444 577766666543
No 336
>KOG4649 consensus PQQ (pyrrolo-quinoline quinone) repeat protein [Secondary metabolites biosynthesis, transport and catabolism]
Probab=96.75 E-value=0.33 Score=42.20 Aligned_cols=148 Identities=9% Similarity=0.024 Sum_probs=89.2
Q ss_pred CCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeC
Q 020784 97 HGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFR 175 (321)
Q Consensus 97 g~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~ 175 (321)
.+++..|+..+ +.--|.++++..+...+ +..+.+-++. -++.+++.. ..+.+.+-++++|..+..+..-
T Consensus 23 kT~v~igSHs~~~~avd~~sG~~~We~il--g~RiE~sa~v-vgdfVV~GC-------y~g~lYfl~~~tGs~~w~f~~~ 92 (354)
T KOG4649|consen 23 KTLVVIGSHSGIVIAVDPQSGNLIWEAIL--GVRIECSAIV-VGDFVVLGC-------YSGGLYFLCVKTGSQIWNFVIL 92 (354)
T ss_pred ceEEEEecCCceEEEecCCCCcEEeehhh--CceeeeeeEE-ECCEEEEEE-------ccCcEEEEEecchhheeeeeeh
Confidence 45677788755 44667788877766665 5556554443 355555554 4588999999999877777665
Q ss_pred CceeE---EEEeCCeEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcce
Q 020784 176 SEVRS---VKLRRDRIIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRT 251 (321)
Q Consensus 176 ~~v~~---v~~~~~~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~ 251 (321)
..|.. +++....+.+.+ +++.+..|.++...+.+.+-.......-++.+. ++.+.++ ...|.|.--..+..+.
T Consensus 93 ~~vk~~a~~d~~~glIycgshd~~~yalD~~~~~cVykskcgG~~f~sP~i~~g-~~sly~a--~t~G~vlavt~~~~~~ 169 (354)
T KOG4649|consen 93 ETVKVRAQCDFDGGLIYCGSHDGNFYALDPKTYGCVYKSKCGGGTFVSPVIAPG-DGSLYAA--ITAGAVLAVTKNPYSS 169 (354)
T ss_pred hhhccceEEcCCCceEEEecCCCcEEEecccccceEEecccCCceeccceecCC-CceEEEE--eccceEEEEccCCCCc
Confidence 55443 445555666665 468999999998888887655443333445443 3334432 3344444333333333
Q ss_pred EEeecc
Q 020784 252 KFIMAH 257 (321)
Q Consensus 252 ~~l~~H 257 (321)
+++-.|
T Consensus 170 ~~~w~~ 175 (354)
T KOG4649|consen 170 TEFWAA 175 (354)
T ss_pred ceehhh
Confidence 444444
No 337
>cd00216 PQQ_DH Dehydrogenases with pyrrolo-quinoline quinone (PQQ) as cofactor, like ethanol, methanol, and membrane bound glucose dehydrogenases. The alignment model contains an 8-bladed beta-propeller.
Probab=96.67 E-value=0.61 Score=45.17 Aligned_cols=191 Identities=14% Similarity=0.178 Sum_probs=102.2
Q ss_pred CCCEEEEEcCCcEEEEEecCCceeEEeeeecCCce----EEEE---EecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcE
Q 020784 96 DHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGI----GVVE---MLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRC 168 (321)
Q Consensus 96 dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v----~~v~---~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~ 168 (321)
+|+.++...+..+.-.|..+++.+...... .... ..+. ...+...+.+.+ .++.|.-+|.++|+.
T Consensus 61 ~g~vy~~~~~g~l~AlD~~tG~~~W~~~~~-~~~~~~~~~~~~~g~~~~~~~~V~v~~-------~~g~v~AlD~~TG~~ 132 (488)
T cd00216 61 DGDMYFTTSHSALFALDAATGKVLWRYDPK-LPADRGCCDVVNRGVAYWDPRKVFFGT-------FDGRLVALDAETGKQ 132 (488)
T ss_pred CCEEEEeCCCCcEEEEECCCChhhceeCCC-CCccccccccccCCcEEccCCeEEEec-------CCCeEEEEECCCCCE
Confidence 444444333444666677777776555431 1100 0000 011214444444 468999999999998
Q ss_pred EEEEeeCCc------ee-EEEEeCCeEEEEE----------CCEEEEEEcCCcEEEEEEeccCCCC--------------
Q 020784 169 IGELSFRSE------VR-SVKLRRDRIIVVL----------EQKIFVYNFADLKLLHQIETIANPK-------------- 217 (321)
Q Consensus 169 ~~~~~~~~~------v~-~v~~~~~~~~~~~----------~~~I~iwd~~~~~~~~~l~~~~~~~-------------- 217 (321)
+-.++.... +. +..+....+++.. ++.+..+|..+++.+-+++......
T Consensus 133 ~W~~~~~~~~~~~~~i~ssP~v~~~~v~vg~~~~~~~~~~~~g~v~alD~~TG~~~W~~~~~~~~~~~~~~~~~~~~~~~ 212 (488)
T cd00216 133 VWKFGNNDQVPPGYTMTGAPTIVKKLVIIGSSGAEFFACGVRGALRAYDVETGKLLWRFYTTEPDPNAFPTWGPDRQMWG 212 (488)
T ss_pred eeeecCCCCcCcceEecCCCEEECCEEEEeccccccccCCCCcEEEEEECCCCceeeEeeccCCCcCCCCCCCCCcceec
Confidence 877765443 21 2233445555543 3578889999999988876532110
Q ss_pred -------ceEEEeeCCCceEEEeecCCCC------------------cEEEEeeCCcceE-Eee--cccc----ceeEEE
Q 020784 218 -------GLCAVSQGVGSLVLVCPGLQKG------------------QVRVEHYASKRTK-FIM--AHDS----RIACFA 265 (321)
Q Consensus 218 -------~~~~~s~~~d~~~la~sGs~dg------------------~V~i~d~~~~~~~-~l~--~H~~----~V~~va 265 (321)
...++... ++.+++ |+.++ .|.-.|..++... .++ .|.. ......
T Consensus 213 ~~g~~vw~~pa~d~~-~g~V~v--g~~~g~~~~~~~~~~~~~~~~~~~l~Ald~~tG~~~W~~~~~~~~~~~~~~~s~p~ 289 (488)
T cd00216 213 PGGGTSWASPTYDPK-TNLVYV--GTGNGSPWNWGGRRTPGDNLYTDSIVALDADTGKVKWFYQTTPHDLWDYDGPNQPS 289 (488)
T ss_pred CCCCCccCCeeEeCC-CCEEEE--ECCCCCCCccCCccCCCCCCceeeEEEEcCCCCCEEEEeeCCCCCCcccccCCCCe
Confidence 01111111 223333 44444 4555777766654 221 2211 111111
Q ss_pred EC----CCCC---EEEEEeCCCcEEEEEEcCCCcEEEEEe
Q 020784 266 LT----QDGQ---LLATSSTKGTLVRIFNTLDGTLLQEEC 298 (321)
Q Consensus 266 fs----pdg~---~las~S~Dgt~IrIWd~~tg~~i~~~~ 298 (321)
+. -+|. .++.++.+|. +..+|.++|+.+-+++
T Consensus 290 ~~~~~~~~g~~~~~V~~g~~~G~-l~ald~~tG~~~W~~~ 328 (488)
T cd00216 290 LADIKPKDGKPVPAIVHAPKNGF-FYVLDRTTGKLISARP 328 (488)
T ss_pred EEeccccCCCeeEEEEEECCCce-EEEEECCCCcEeeEeE
Confidence 11 1343 5777888999 9999999999987664
No 338
>PF14783 BBS2_Mid: Ciliary BBSome complex subunit 2, middle region
Probab=96.66 E-value=0.091 Score=39.63 Aligned_cols=86 Identities=15% Similarity=0.181 Sum_probs=58.7
Q ss_pred CCCcEEEEeCCCCcEEEEEeeCCceeEEEEe-CCeEEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEE
Q 020784 154 PLNKVMIWDDHQSRCIGELSFRSEVRSVKLR-RDRIIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVL 231 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~-~~~~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~l 231 (321)
.|..||||+-. +.+.++.....|.+++-. ..+++-+. .++|.+|+- .+.+..++....+.....+..++|+..-
T Consensus 23 ~D~~IRvf~~~--e~~~Ei~e~~~v~~L~~~~~~~F~Y~l~NGTVGvY~~--~~RlWRiKSK~~~~~~~~~D~~gdG~~e 98 (111)
T PF14783_consen 23 DDFEIRVFKGD--EIVAEITETDKVTSLCSLGGGRFAYALANGTVGVYDR--SQRLWRIKSKNQVTSMAFYDINGDGVPE 98 (111)
T ss_pred CCcEEEEEeCC--cEEEEEecccceEEEEEcCCCEEEEEecCCEEEEEeC--cceeeeeccCCCeEEEEEEcCCCCCceE
Confidence 68999999754 678888888888887754 45555555 469999975 3444556665555556666666665433
Q ss_pred EeecCCCCcEEE
Q 020784 232 VCPGLQKGQVRV 243 (321)
Q Consensus 232 a~sGs~dg~V~i 243 (321)
.+.|-.+|.|.+
T Consensus 99 LI~GwsnGkve~ 110 (111)
T PF14783_consen 99 LIVGWSNGKVEV 110 (111)
T ss_pred EEEEecCCeEEe
Confidence 335888888764
No 339
>PF00930 DPPIV_N: Dipeptidyl peptidase IV (DPP IV) N-terminal region; InterPro: IPR002469 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This domain defines serine peptidases belonging to MEROPS peptidase family S9 (clan SC), subfamily S9B (dipeptidyl-peptidase IV). The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. This domain is an alignment of the region to the N-terminal side of the active site, which is found in IPR001375 from INTERPRO. CD26 (3.4.14.5 from EC) is also called adenosine deaminase-binding protein (ADA-binding protein) or dipeptidylpeptidase IV (DPP IV ectoenzyme). The exopeptidase cleaves off N-terminal X-Pro or X-Ala dipeptides from polypeptides (dipeptidyl peptidase IV activity). CD26 serves as the costimulatory molecule in T cell activation and is an associated marker of autoimmune diseases, adenosine deaminase-deficiency and HIV pathogenesis. Dipeptidyl peptidase IV (DPP IV) is responsible for the removal of N-terminal dipeptides sequentially from polypeptides having unsubstituted N termini, provided that the penultimate residue is proline. The enzyme catalyses the reaction: Dipeptidyl-Polypeptide + H(2)O = Dipeptide + Polypeptide It is a type II membrane protein that forms a homodimer. CD molecules are leucocyte antigens on cell surfaces. CD antigens nomenclature is updated at Protein Reviews On The Web (http://prow.nci.nih.gov/). ; GO: 0006508 proteolysis, 0016020 membrane; PDB: 2RIP_A 3Q8W_B 2AJL_I 1TKR_B 1TK3_B 3C45_A 2G5P_A 3G0C_D 1R9M_C 1RWQ_A ....
Probab=96.65 E-value=0.54 Score=43.39 Aligned_cols=229 Identities=10% Similarity=0.015 Sum_probs=122.1
Q ss_pred CCeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeeec-----------------CCceEEEEEecCCCeEEEEeCC
Q 020784 86 PTLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFER-----------------GGGIGVVEMLFRCNILALVGGG 148 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~-----------------~~~v~~v~~~~~~~~~~~~sg~ 148 (321)
..+....|+|||++||-..++.+.+++..+... ...+... -+.-..+-|++++..++...-+
T Consensus 43 ~~~~~~~~sP~g~~~~~v~~~nly~~~~~~~~~-~~lT~dg~~~i~nG~~dwvyeEEv~~~~~~~~WSpd~~~la~~~~d 121 (353)
T PF00930_consen 43 PKLQDAKWSPDGKYIAFVRDNNLYLRDLATGQE-TQLTTDGEPGIYNGVPDWVYEEEVFDRRSAVWWSPDSKYLAFLRFD 121 (353)
T ss_dssp TTBSEEEE-SSSTEEEEEETTEEEEESSTTSEE-EESES--TTTEEESB--HHHHHHTSSSSBSEEE-TTSSEEEEEEEE
T ss_pred cccccceeecCCCeeEEEecCceEEEECCCCCe-EEeccccceeEEcCccceeccccccccccceEECCCCCEEEEEEEC
Confidence 467889999999999999988888887765532 2222210 0122456688888888765422
Q ss_pred CCC---------------------------CC--CCCcEEEEeCCCCcEEE-EEe-----eCCceeEEEEeCCe--EEEE
Q 020784 149 PDP---------------------------QY--PLNKVMIWDDHQSRCIG-ELS-----FRSEVRSVKLRRDR--IIVV 191 (321)
Q Consensus 149 ~~~---------------------------~~--~d~~v~iWD~~~~~~~~-~~~-----~~~~v~~v~~~~~~--~~~~ 191 (321)
+.. .. ..-.+.|+|+.+++... ... ....+..+.|.++. +++.
T Consensus 122 ~~~v~~~~~~~~~~~~~~yp~~~~~~YPk~G~~np~v~l~v~~~~~~~~~~~~~~~~~~~~~~yl~~v~W~~d~~~l~~~ 201 (353)
T PF00930_consen 122 EREVPEYPLPDYSPPDSQYPEVESIRYPKAGDPNPRVSLFVVDLASGKTTELDPPNSLNPQDYYLTRVGWSPDGKRLWVQ 201 (353)
T ss_dssp -TTS-EEEEEEESSSTESS-EEEEEE--BTTS---EEEEEEEESSSTCCCEE---HHHHTSSEEEEEEEEEETTEEEEEE
T ss_pred CcCCceEEeeccCCccccCCcccccccCCCCCcCCceEEEEEECCCCcEEEeeeccccCCCccCcccceecCCCcEEEEE
Confidence 100 00 00125567777665421 111 12246678886653 3433
Q ss_pred E----CC--EEEEEEcCCcEEEEEEec-cCCCC---ceEEEe-eCCCceEEEeecCCCCcEEE--EeeCCcceEEeeccc
Q 020784 192 L----EQ--KIFVYNFADLKLLHQIET-IANPK---GLCAVS-QGVGSLVLVCPGLQKGQVRV--EHYASKRTKFIMAHD 258 (321)
Q Consensus 192 ~----~~--~I~iwd~~~~~~~~~l~~-~~~~~---~~~~~s-~~~d~~~la~sGs~dg~V~i--~d~~~~~~~~l~~H~ 258 (321)
. .+ .+.+.|..+++....+.. ....+ ....+. .+++ .++-. ...+|.-.| .+...+....+....
T Consensus 202 ~~nR~q~~~~l~~~d~~tg~~~~~~~e~~~~Wv~~~~~~~~~~~~~~-~~l~~-s~~~G~~hly~~~~~~~~~~~lT~G~ 279 (353)
T PF00930_consen 202 WLNRDQNRLDLVLCDASTGETRVVLEETSDGWVDVYDPPHFLGPDGN-EFLWI-SERDGYRHLYLYDLDGGKPRQLTSGD 279 (353)
T ss_dssp EEETTSTEEEEEEEEECTTTCEEEEEEESSSSSSSSSEEEE-TTTSS-EEEEE-EETTSSEEEEEEETTSSEEEESS-SS
T ss_pred EcccCCCEEEEEEEECCCCceeEEEEecCCcceeeecccccccCCCC-EEEEE-EEcCCCcEEEEEcccccceeccccCc
Confidence 2 23 566777765543222222 22222 233333 3433 33333 337776666 566666666777777
Q ss_pred cceeE-EEECCCCCEE-EEEeCCC--c-EEEEEEcCCCcEEEEEeCCCcce-eEEEeecCceEEE
Q 020784 259 SRIAC-FALTQDGQLL-ATSSTKG--T-LVRIFNTLDGTLLQEECCPSISA-QSGLWLSSAWLRV 317 (321)
Q Consensus 259 ~~V~~-vafspdg~~l-as~S~Dg--t-~IrIWd~~tg~~i~~~~~g~~~~-~~~~s~d~~~la~ 317 (321)
-.|+. +.+++++..| .+|..++ . .|..-++.++..+..+..+.... ...||+|++|++.
T Consensus 280 ~~V~~i~~~d~~~~~iyf~a~~~~p~~r~lY~v~~~~~~~~~~LT~~~~~~~~~~~Spdg~y~v~ 344 (353)
T PF00930_consen 280 WEVTSILGWDEDNNRIYFTANGDNPGERHLYRVSLDSGGEPKCLTCEDGDHYSASFSPDGKYYVD 344 (353)
T ss_dssp S-EEEEEEEECTSSEEEEEESSGGTTSBEEEEEETTETTEEEESSTTSSTTEEEEE-TTSSEEEE
T ss_pred eeecccceEcCCCCEEEEEecCCCCCceEEEEEEeCCCCCeEeccCCCCCceEEEECCCCCEEEE
Confidence 77865 6778886643 3555422 2 14444555244556665555554 7799999999865
No 340
>PF08596 Lgl_C: Lethal giant larvae(Lgl) like, C-terminal; InterPro: IPR013905 The Lethal giant larvae (Lgl) tumour suppressor protein is conserved from yeast to mammals. The Lgl protein functions in cell polarity, at least in part, by regulating SNARE-mediated membrane delivery events at the cell surface []. The N-terminal half of Lgl members contains WD40 repeats (see IPR001680 from INTERPRO), while the C-terminal half appears specific to the protein []. ; PDB: 2OAJ_A.
Probab=96.60 E-value=0.35 Score=45.39 Aligned_cols=195 Identities=18% Similarity=0.277 Sum_probs=96.8
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeec-------CCceEEEEEe---cCCC----eEEEEe
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFER-------GGGIGVVEML---FRCN----ILALVG 146 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~-------~~~v~~v~~~---~~~~----~~~~~s 146 (321)
+...++|++++.|.=| ++|.|.++| +.|.|+.-...++...... ...+..++|. ...+ ...+++
T Consensus 83 ~~~~g~vtal~~S~iG-Fvaigy~~G~l~viD~RGPavI~~~~i~~~~~~~~~~~~vt~ieF~vm~~~~D~ySSi~L~vG 161 (395)
T PF08596_consen 83 DAKQGPVTALKNSDIG-FVAIGYESGSLVVIDLRGPAVIYNENIRESFLSKSSSSYVTSIEFSVMTLGGDGYSSICLLVG 161 (395)
T ss_dssp ---S-SEEEEEE-BTS-EEEEEETTSEEEEEETTTTEEEEEEEGGG--T-SS----EEEEEEEEEE-TTSSSEEEEEEEE
T ss_pred eccCCcEeEEecCCCc-EEEEEecCCcEEEEECCCCeEEeeccccccccccccccCeeEEEEEEEecCCCcccceEEEEE
Confidence 4456899999998545 899999866 7799997777766644421 1234455553 1111 222222
Q ss_pred CCCCCCCCCCcEEEEeCC--C-CcEEEEE-----eeCCceeEEE-EeCC-----------------------eEEEEECC
Q 020784 147 GGPDPQYPLNKVMIWDDH--Q-SRCIGEL-----SFRSEVRSVK-LRRD-----------------------RIIVVLEQ 194 (321)
Q Consensus 147 g~~~~~~~d~~v~iWD~~--~-~~~~~~~-----~~~~~v~~v~-~~~~-----------------------~~~~~~~~ 194 (321)
. +.|.+.+|.+. . +.....+ .....|..+. ++.+ .++++++.
T Consensus 162 -T-----n~G~v~~fkIlp~~~g~f~v~~~~~~~~~~~~i~~I~~i~~~~G~~a~At~~~~~~l~~g~~i~g~vVvvSe~ 235 (395)
T PF08596_consen 162 -T-----NSGNVLTFKILPSSNGRFSVQFAGATTNHDSPILSIIPINADTGESALATISAMQGLSKGISIPGYVVVVSES 235 (395)
T ss_dssp -E-----TTSEEEEEEEEE-GGG-EEEEEEEEE--SS----EEEEEETTT--B-B-BHHHHHGGGGT----EEEEEE-SS
T ss_pred -e-----CCCCEEEEEEecCCCCceEEEEeeccccCCCceEEEEEEECCCCCcccCchhHhhccccCCCcCcEEEEEccc
Confidence 1 45889988754 1 2222111 2334555544 3221 45666788
Q ss_pred EEEEEEcCCcEEEEEEeccCCCCc--eEEEee---CCCceEEEeecCCCCcEEEEeeCC-cceEEeec----cccceeEE
Q 020784 195 KIFVYNFADLKLLHQIETIANPKG--LCAVSQ---GVGSLVLVCPGLQKGQVRVEHYAS-KRTKFIMA----HDSRIACF 264 (321)
Q Consensus 195 ~I~iwd~~~~~~~~~l~~~~~~~~--~~~~s~---~~d~~~la~sGs~dg~V~i~d~~~-~~~~~l~~----H~~~V~~v 264 (321)
.||++...+.+..++... .+.. .+++.. ...+..|++ =..+|.|+++.+-. +.+..++- +...+...
T Consensus 236 ~irv~~~~~~k~~~K~~~--~~~~~~~~~vv~~~~~~~~~~Lv~-l~~~G~i~i~SLP~Lkei~~~~l~~~~d~~~~~~s 312 (395)
T PF08596_consen 236 DIRVFKPPKSKGAHKSFD--DPFLCSSASVVPTISRNGGYCLVC-LFNNGSIRIYSLPSLKEIKSVSLPPPLDSRRLSSS 312 (395)
T ss_dssp EEEEE-TT---EEEEE-S--S-EEEEEEEEEEEE-EEEEEEEEE-EETTSEEEEEETTT--EEEEEE-SS---HHHHTT-
T ss_pred ceEEEeCCCCcccceeec--cccccceEEEEeecccCCceEEEE-EECCCcEEEEECCCchHhhcccCCCcccccccccc
Confidence 999999988777666542 2222 222321 112233332 47889999988653 34444433 33456778
Q ss_pred EECCCCCEEEEEeCCCcEEEEEEc
Q 020784 265 ALTQDGQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 265 afspdg~~las~S~Dgt~IrIWd~ 288 (321)
+|+++|..|.-.|.. . +.+|.+
T Consensus 313 sis~~Gdi~~~~gps-E-~~l~sv 334 (395)
T PF08596_consen 313 SISRNGDIFYWTGPS-E-IQLFSV 334 (395)
T ss_dssp EE-TTS-EEEE-SSS-E-EEEEEE
T ss_pred EECCCCCEEEEeCcc-c-EEEEEE
Confidence 889999988766533 3 455544
No 341
>KOG1920 consensus IkappaB kinase complex, IKAP component [Transcription]
Probab=96.58 E-value=0.21 Score=51.81 Aligned_cols=180 Identities=12% Similarity=0.121 Sum_probs=103.2
Q ss_pred CceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCe--EEEEECCEEEEEEcCCcE
Q 020784 128 GGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDR--IIVVLEQKIFVYNFADLK 205 (321)
Q Consensus 128 ~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~--~~~~~~~~I~iwd~~~~~ 205 (321)
+.|..+.+.-+.+.++++. ..|.|.+-|..+......=.....|.+.+|+++. +++++....-+....+..
T Consensus 69 ~~i~s~~fl~d~~~i~v~~-------~~G~iilvd~et~~~eivg~vd~GI~aaswS~Dee~l~liT~~~tll~mT~~f~ 141 (1265)
T KOG1920|consen 69 DEIVSVQFLADTNSICVIT-------ALGDIILVDPETLELEIVGNVDNGISAASWSPDEELLALITGRQTLLFMTKDFE 141 (1265)
T ss_pred cceEEEEEecccceEEEEe-------cCCcEEEEcccccceeeeeeccCceEEEeecCCCcEEEEEeCCcEEEEEecccc
Confidence 4566667777888888877 4588888888876643333345678899999875 444555333333222111
Q ss_pred EEE------------------------EEeccC-------------------CCCceEEEeeCCCceEEEeec----CCC
Q 020784 206 LLH------------------------QIETIA-------------------NPKGLCAVSQGVGSLVLVCPG----LQK 238 (321)
Q Consensus 206 ~~~------------------------~l~~~~-------------------~~~~~~~~s~~~d~~~la~sG----s~d 238 (321)
++. .|.+.. ....-..+++.+||.++|+++ ..-
T Consensus 142 ~i~E~~L~~d~~~~sk~v~VGwGrkeTqfrgs~gr~~~~~~~~~ek~~~~~~~~~~~~~IsWRgDg~~fAVs~~~~~~~~ 221 (1265)
T KOG1920|consen 142 PIAEKPLDADDERKSKFVNVGWGRKETQFRGSEGRQAARQKIEKEKALEQIEQDDHKTSISWRGDGEYFAVSFVESETGT 221 (1265)
T ss_pred chhccccccccccccccceecccccceeeecchhhhcccccccccccccchhhccCCceEEEccCCcEEEEEEEeccCCc
Confidence 111 111100 001123488999999998743 222
Q ss_pred CcEEEEeeCCcceE-EeeccccceeEEEECCCCCEEEEE---eCCCcEEEEEEcCCCcEEEEEeCC---Cc--ceeEEEe
Q 020784 239 GQVRVEHYASKRTK-FIMAHDSRIACFALTQDGQLLATS---STKGTLVRIFNTLDGTLLQEECCP---SI--SAQSGLW 309 (321)
Q Consensus 239 g~V~i~d~~~~~~~-~l~~H~~~V~~vafspdg~~las~---S~Dgt~IrIWd~~tg~~i~~~~~g---~~--~~~~~~s 309 (321)
..|+|||.. +.+. +-..-.+-=.+++|-|.|.++|+- ..|++ |.+|.- +|-.-..|... .. ...+.+.
T Consensus 222 RkirV~drE-g~Lns~se~~~~l~~~LsWkPsgs~iA~iq~~~sd~~-IvffEr-NGL~hg~f~l~~p~de~~ve~L~Wn 298 (1265)
T KOG1920|consen 222 RKIRVYDRE-GALNSTSEPVEGLQHSLSWKPSGSLIAAIQCKTSDSD-IVFFER-NGLRHGEFVLPFPLDEKEVEELAWN 298 (1265)
T ss_pred eeEEEeccc-chhhcccCcccccccceeecCCCCeEeeeeecCCCCc-EEEEec-CCccccccccCCcccccchheeeec
Confidence 689999976 3322 222223334689999999999984 33667 888873 33332322211 11 1234556
Q ss_pred ecCceEEE
Q 020784 310 LSSAWLRV 317 (321)
Q Consensus 310 ~d~~~la~ 317 (321)
.++..||+
T Consensus 299 s~sdiLAv 306 (1265)
T KOG1920|consen 299 SNSDILAV 306 (1265)
T ss_pred CCCCceee
Confidence 66677776
No 342
>PF03178 CPSF_A: CPSF A subunit region; InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=96.57 E-value=0.56 Score=42.60 Aligned_cols=174 Identities=15% Similarity=0.252 Sum_probs=94.2
Q ss_pred CCEEEEEcC---------C-c-EEEEEecCC-----ceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 97 HGCFAAGTD---------H-G-FRIYNCDPF-----REIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 97 g~~lasg~~---------~-g-v~vw~~~~~-----~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
-.+|+.|.. . | +.++++... +.....+....+.+..++.. .+.+++.++ ++|.+
T Consensus 42 ~~~ivVGT~~~~~~~~~~~~Gri~v~~i~~~~~~~~~l~~i~~~~~~g~V~ai~~~-~~~lv~~~g---------~~l~v 111 (321)
T PF03178_consen 42 KEYIVVGTAFNYGEDPEPSSGRILVFEISESPENNFKLKLIHSTEVKGPVTAICSF-NGRLVVAVG---------NKLYV 111 (321)
T ss_dssp SEEEEEEEEE--TTSSS-S-EEEEEEEECSS-----EEEEEEEEEESS-EEEEEEE-TTEEEEEET---------TEEEE
T ss_pred cCEEEEEecccccccccccCcEEEEEEEEcccccceEEEEEEEEeecCcceEhhhh-CCEEEEeec---------CEEEE
Confidence 467887763 1 5 669998774 32222222136777777654 444333333 78999
Q ss_pred EeCCCCc-EEEEEee--CCceeEEEEeCCeEEEEEC-CEEEEEEcC-CcEEEEEEeccCCCCceEEE--eeCCCceEEEe
Q 020784 161 WDDHQSR-CIGELSF--RSEVRSVKLRRDRIIVVLE-QKIFVYNFA-DLKLLHQIETIANPKGLCAV--SQGVGSLVLVC 233 (321)
Q Consensus 161 WD~~~~~-~~~~~~~--~~~v~~v~~~~~~~~~~~~-~~I~iwd~~-~~~~~~~l~~~~~~~~~~~~--s~~~d~~~la~ 233 (321)
|++...+ ....... ...+.++...++.++++.. +.+.++... ..+.+..+.....+..+.++ -.+.+ .+++
T Consensus 112 ~~l~~~~~l~~~~~~~~~~~i~sl~~~~~~I~vgD~~~sv~~~~~~~~~~~l~~va~d~~~~~v~~~~~l~d~~-~~i~- 189 (321)
T PF03178_consen 112 YDLDNSKTLLKKAFYDSPFYITSLSVFKNYILVGDAMKSVSLLRYDEENNKLILVARDYQPRWVTAAEFLVDED-TIIV- 189 (321)
T ss_dssp EEEETTSSEEEEEEE-BSSSEEEEEEETTEEEEEESSSSEEEEEEETTTE-EEEEEEESS-BEEEEEEEE-SSS-EEEE-
T ss_pred EEccCcccchhhheecceEEEEEEeccccEEEEEEcccCEEEEEEEccCCEEEEEEecCCCccEEEEEEecCCc-EEEE-
Confidence 9998877 6554444 3467888888887777754 556655442 23333444433334444443 33443 4444
Q ss_pred ecCCCCcEEEEeeCC-------c--ceE-Eeecc-ccceeEE---EECC--CCC------EEEEEeCCCcEEE
Q 020784 234 PGLQKGQVRVEHYAS-------K--RTK-FIMAH-DSRIACF---ALTQ--DGQ------LLATSSTKGTLVR 284 (321)
Q Consensus 234 sGs~dg~V~i~d~~~-------~--~~~-~l~~H-~~~V~~v---afsp--dg~------~las~S~Dgt~Ir 284 (321)
++.+|.+.++.+.. + .+. ...-| ...|+++ ++.| .+. .++-++.+|. |-
T Consensus 190 -~D~~gnl~~l~~~~~~~~~~~~~~~L~~~~~f~lg~~v~~~~~~~l~~~~~~~~~~~~~~i~~~T~~G~-Ig 260 (321)
T PF03178_consen 190 -GDKDGNLFVLRYNPEIPNSRDGDPKLERISSFHLGDIVNSFRRGSLIPRSGSSESPNRPQILYGTVDGS-IG 260 (321)
T ss_dssp -EETTSEEEEEEE-SS-SSTTTTTTBEEEEEEEE-SS-EEEEEE--SS--SSSS-TTEEEEEEEEETTS--EE
T ss_pred -EcCCCeEEEEEECCCCcccccccccceeEEEEECCCccceEEEEEeeecCCCCcccccceEEEEecCCE-EE
Confidence 79999999965542 1 222 22223 4557777 5555 222 3666777888 54
No 343
>PF04053 Coatomer_WDAD: Coatomer WD associated region ; InterPro: IPR006692 Proteins synthesised on the ribosome and processed in the endoplasmic reticulum are transported from the Golgi apparatus to the trans-Golgi network (TGN), and from there via small carrier vesicles to their final destination compartment. This traffic is bidirectional, to ensure that proteins required to form vesicles are recycled. Vesicles have specific coat proteins (such as clathrin or coatomer) that are important for cargo selection and direction of transfer []. While clathrin mediates endocytic protein transport, and transport from ER to Golgi, coatomers primarily mediate intra-Golgi transport, as well as the reverse Golgi to ER transport of dilysine-tagged proteins []. For example, the coatomer COP1 (coat protein complex 1) is responsible for reverse transport of recycled proteins from Golgi and pre-Golgi compartments back to the ER, while COPII buds vesicles from the ER to the Golgi []. Coatomers reversibly associate with Golgi (non-clathrin-coated) vesicles to mediate protein transport and for budding from Golgi membranes []. Activated small guanine triphosphatases (GTPases) attract coat proteins to specific membrane export sites, thereby linking coatomers to export cargos. As coat proteins polymerise, vesicles are formed and budded from membrane-bound organelles. Coatomer complexes also influence Golgi structural integrity, as well as the processing, activity, and endocytic recycling of LDL receptors. In mammals, coatomer complexes can only be recruited by membranes associated to ADP-ribosylation factors (ARFs), which are small GTP-binding proteins. Coatomer complexes are hetero-oligomers composed of at least an alpha, beta, beta', gamma, delta, epsilon and zeta subunits. This entry represents the WD-associated region found in coatomer subunits alpha, beta and beta' subunits. The alpha-subunit (RET1P) of the coatomer complex in Saccharomyces cerevisiae (Baker's yeast), participates in membrane transport between the endoplasmic reticulum and Golgi apparatus. The protein contains six WD-40 repeat motifs in its N-terminal region []. More information about these proteins can be found at Protein of the Month: Clathrin [].; GO: 0005198 structural molecule activity, 0006886 intracellular protein transport, 0016192 vesicle-mediated transport, 0030117 membrane coat; PDB: 3MKQ_B.
Probab=96.56 E-value=0.13 Score=48.95 Aligned_cols=133 Identities=13% Similarity=0.042 Sum_probs=76.4
Q ss_pred CCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCC----------
Q 020784 97 HGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQS---------- 166 (321)
Q Consensus 97 g~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~---------- 166 (321)
|.+|+..+++.+.+||+++.+.+..... ..+..|.|+.+++.+++++ +.++.|++.+..
T Consensus 117 G~LL~~~~~~~i~~yDw~~~~~i~~i~v---~~vk~V~Ws~~g~~val~t--------~~~i~il~~~~~~~~~~~~~g~ 185 (443)
T PF04053_consen 117 GNLLGVKSSDFICFYDWETGKLIRRIDV---SAVKYVIWSDDGELVALVT--------KDSIYILKYNLEAVAAIPEEGV 185 (443)
T ss_dssp SSSEEEEETTEEEEE-TTT--EEEEESS----E-EEEEE-TTSSEEEEE---------S-SEEEEEE-HHHHHHBTTTB-
T ss_pred CcEEEEECCCCEEEEEhhHcceeeEEec---CCCcEEEEECCCCEEEEEe--------CCeEEEEEecchhcccccccCc
Confidence 8888888888899999999988766663 4478999999999999987 467888875544
Q ss_pred --cEEEEEeeCCceeEEEEeCCeEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEE
Q 020784 167 --RCIGELSFRSEVRSVKLRRDRIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVE 244 (321)
Q Consensus 167 --~~~~~~~~~~~v~~v~~~~~~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~ 244 (321)
......+....|.+..|..+-++-.+.+.|+.+- +|+. .++..-..+..++.+.+.. +.+.++ +.|+.|..+
T Consensus 186 e~~f~~~~E~~~~IkSg~W~~d~fiYtT~~~lkYl~--~Ge~-~~i~~ld~~~yllgy~~~~-~~ly~~--Dr~~~v~~~ 259 (443)
T PF04053_consen 186 EDAFELIHEISERIKSGCWVEDCFIYTTSNHLKYLV--NGET-GIIAHLDKPLYLLGYLPKE-NRLYLI--DRDGNVISY 259 (443)
T ss_dssp GGGEEEEEEE-S--SEEEEETTEEEEE-TTEEEEEE--TTEE-EEEEE-SS--EEEEEETTT-TEEEEE---TT--EEEE
T ss_pred hhceEEEEEecceeEEEEEEcCEEEEEcCCeEEEEE--cCCc-ceEEEcCCceEEEEEEccC-CEEEEE--ECCCCEEEE
Confidence 2222222366899999999966666777888733 3332 2333334566677776643 244442 667676665
Q ss_pred ee
Q 020784 245 HY 246 (321)
Q Consensus 245 d~ 246 (321)
.+
T Consensus 260 ~l 261 (443)
T PF04053_consen 260 EL 261 (443)
T ss_dssp E-
T ss_pred EE
Confidence 43
No 344
>COG3391 Uncharacterized conserved protein [Function unknown]
Probab=96.56 E-value=0.67 Score=43.33 Aligned_cols=207 Identities=11% Similarity=0.076 Sum_probs=134.2
Q ss_pred eEEEEEcCCCCEEE-EEc-CCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCC
Q 020784 88 LLHISFNQDHGCFA-AGT-DHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQ 165 (321)
Q Consensus 88 V~~v~fs~dg~~la-sg~-~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~ 165 (321)
-..++++++|..+. +.. .+.|.+.|..+.+....... +..-..+.+.+++..+.++..+. .++++-+.|..+
T Consensus 76 p~~i~v~~~~~~vyv~~~~~~~v~vid~~~~~~~~~~~v--G~~P~~~~~~~~~~~vYV~n~~~----~~~~vsvid~~t 149 (381)
T COG3391 76 PAGVAVNPAGNKVYVTTGDSNTVSVIDTATNTVLGSIPV--GLGPVGLAVDPDGKYVYVANAGN----GNNTVSVIDAAT 149 (381)
T ss_pred ccceeeCCCCCeEEEecCCCCeEEEEcCcccceeeEeee--ccCCceEEECCCCCEEEEEeccc----CCceEEEEeCCC
Confidence 34688899888544 333 47788999777766555443 22344567777887777666431 258899999998
Q ss_pred CcEEEEEeeCCceeEEEEeCC--eEEEEE--CCEEEEEEcCCcEEEE-E----EeccCCCCceEEEeeCCCceEEEeecC
Q 020784 166 SRCIGELSFRSEVRSVKLRRD--RIIVVL--EQKIFVYNFADLKLLH-Q----IETIANPKGLCAVSQGVGSLVLVCPGL 236 (321)
Q Consensus 166 ~~~~~~~~~~~~v~~v~~~~~--~~~~~~--~~~I~iwd~~~~~~~~-~----l~~~~~~~~~~~~s~~~d~~~la~sGs 236 (321)
+..+...........+.+.++ .++++. ++.|.+.|.......+ . +..+..+ ....+.+++...+++.-++
T Consensus 150 ~~~~~~~~vG~~P~~~a~~p~g~~vyv~~~~~~~v~vi~~~~~~v~~~~~~~~~~~~~~P-~~i~v~~~g~~~yV~~~~~ 228 (381)
T COG3391 150 NKVTATIPVGNTPTGVAVDPDGNKVYVTNSDDNTVSVIDTSGNSVVRGSVGSLVGVGTGP-AGIAVDPDGNRVYVANDGS 228 (381)
T ss_pred CeEEEEEecCCCcceEEECCCCCeEEEEecCCCeEEEEeCCCcceeccccccccccCCCC-ceEEECCCCCEEEEEeccC
Confidence 888877544444577888765 455554 5799999987766553 1 1111111 2445566555455554333
Q ss_pred CCCcEEEEeeCCcceEEe--eccccceeEEEECCCCCEEEEEeCC-CcEEEEEEcCCCcEEEEEeCCCc
Q 020784 237 QKGQVRVEHYASKRTKFI--MAHDSRIACFALTQDGQLLATSSTK-GTLVRIFNTLDGTLLQEECCPSI 302 (321)
Q Consensus 237 ~dg~V~i~d~~~~~~~~l--~~H~~~V~~vafspdg~~las~S~D-gt~IrIWd~~tg~~i~~~~~g~~ 302 (321)
.++.+...|...+.+... ..-......++++|+|..+-..... ++ +.+-|..+.++...+..+..
T Consensus 229 ~~~~v~~id~~~~~v~~~~~~~~~~~~~~v~~~p~g~~~yv~~~~~~~-V~vid~~~~~v~~~~~~~~~ 296 (381)
T COG3391 229 GSNNVLKIDTATGNVTATDLPVGSGAPRGVAVDPAGKAAYVANSQGGT-VSVIDGATDRVVKTGPTGNE 296 (381)
T ss_pred CCceEEEEeCCCceEEEeccccccCCCCceeECCCCCEEEEEecCCCe-EEEEeCCCCceeeeeccccc
Confidence 346787777776655433 1111156789999999988777444 66 99999999998887766555
No 345
>PF14783 BBS2_Mid: Ciliary BBSome complex subunit 2, middle region
Probab=96.56 E-value=0.13 Score=38.85 Aligned_cols=89 Identities=17% Similarity=0.228 Sum_probs=53.1
Q ss_pred CeEEEEECC-EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEEeeccccceeEE
Q 020784 186 DRIIVVLEQ-KIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKFIMAHDSRIACF 264 (321)
Q Consensus 186 ~~~~~~~~~-~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~v 264 (321)
+.+++++++ .||+|+-. +++..+....... .+..-.. ..+++ |..+|+|-+++...+. -..+ -+..++++
T Consensus 16 ~eLlvGs~D~~IRvf~~~--e~~~Ei~e~~~v~---~L~~~~~-~~F~Y-~l~NGTVGvY~~~~Rl-WRiK-SK~~~~~~ 86 (111)
T PF14783_consen 16 NELLVGSDDFEIRVFKGD--EIVAEITETDKVT---SLCSLGG-GRFAY-ALANGTVGVYDRSQRL-WRIK-SKNQVTSM 86 (111)
T ss_pred ceEEEecCCcEEEEEeCC--cEEEEEecccceE---EEEEcCC-CEEEE-EecCCEEEEEeCccee-eeec-cCCCeEEE
Confidence 357777654 99999854 5667776654433 3333333 34665 8999999998754332 2222 22336666
Q ss_pred EEC-CC--C-CEEEEEeCCCcEEE
Q 020784 265 ALT-QD--G-QLLATSSTKGTLVR 284 (321)
Q Consensus 265 afs-pd--g-~~las~S~Dgt~Ir 284 (321)
++. -+ | .-|++|-.+|. |-
T Consensus 87 ~~~D~~gdG~~eLI~GwsnGk-ve 109 (111)
T PF14783_consen 87 AFYDINGDGVPELIVGWSNGK-VE 109 (111)
T ss_pred EEEcCCCCCceEEEEEecCCe-EE
Confidence 554 33 3 35888877887 53
No 346
>KOG4649 consensus PQQ (pyrrolo-quinoline quinone) repeat protein [Secondary metabolites biosynthesis, transport and catabolism]
Probab=96.44 E-value=0.26 Score=42.85 Aligned_cols=105 Identities=10% Similarity=0.001 Sum_probs=67.2
Q ss_pred CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCE
Q 020784 194 QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQL 272 (321)
Q Consensus 194 ~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~ 272 (321)
+.+.--|..+++++..-....... .-++-. + .+++. |...|.+++.+.+++. .-.+..-...=..-...+++.+
T Consensus 33 ~~~~avd~~sG~~~We~ilg~RiE-~sa~vv-g--dfVV~-GCy~g~lYfl~~~tGs~~w~f~~~~~vk~~a~~d~~~gl 107 (354)
T KOG4649|consen 33 GIVIAVDPQSGNLIWEAILGVRIE-CSAIVV-G--DFVVL-GCYSGGLYFLCVKTGSQIWNFVILETVKVRAQCDFDGGL 107 (354)
T ss_pred ceEEEecCCCCcEEeehhhCceee-eeeEEE-C--CEEEE-EEccCcEEEEEecchhheeeeeehhhhccceEEcCCCce
Confidence 456666666666654332221111 112222 2 23443 8999999998888874 4444433332223345688999
Q ss_pred EEEEeCCCcEEEEEEcCCCcEEEEEeCCCcce
Q 020784 273 LATSSTKGTLVRIFNTLDGTLLQEECCPSISA 304 (321)
Q Consensus 273 las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~ 304 (321)
+-.||.|++ ...-|.++..++...+.|....
T Consensus 108 Iycgshd~~-~yalD~~~~~cVykskcgG~~f 138 (354)
T KOG4649|consen 108 IYCGSHDGN-FYALDPKTYGCVYKSKCGGGTF 138 (354)
T ss_pred EEEecCCCc-EEEecccccceEEecccCCcee
Confidence 999999999 9999999999999887766543
No 347
>KOG0882 consensus Cyclophilin-related peptidyl-prolyl cis-trans isomerase [Posttranslational modification, protein turnover, chaperones]
Probab=96.43 E-value=0.051 Score=50.35 Aligned_cols=155 Identities=12% Similarity=0.126 Sum_probs=103.7
Q ss_pred cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEe----eCCceeEEEEeCCeEEEEE----CCEEE
Q 020784 126 RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELS----FRSEVRSVKLRRDRIIVVL----EQKIF 197 (321)
Q Consensus 126 ~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~----~~~~v~~v~~~~~~~~~~~----~~~I~ 197 (321)
|...|..|... -.+.+..++ -||.+|.|.-..-..+..+. +-..+.+++.+.++...++ +..+|
T Consensus 8 hrd~i~hv~~t-ka~fiiqAS-------lDGh~KFWkKs~isGvEfVKhFraHL~~I~sl~~S~dg~L~~Sv~d~Dhs~K 79 (558)
T KOG0882|consen 8 HRDVITHVFPT-KAKFIIQAS-------LDGHKKFWKKSRISGVEFVKHFRAHLGVILSLAVSYDGWLFRSVEDPDHSVK 79 (558)
T ss_pred ccceeeeEeee-hhheEEeee-------cchhhhhcCCCCccceeehhhhHHHHHHHHhhhccccceeEeeccCccccee
Confidence 45556555432 244555555 68999999754322222222 1235666777776655554 56999
Q ss_pred EEEcCCcEEEEEEeccCCCCceEEEeeCCCc-eEEEeecCCCCcEEEEeeCCc--c-eEEeeccccceeEEEECCCCCEE
Q 020784 198 VYNFADLKLLHQIETIANPKGLCAVSQGVGS-LVLVCPGLQKGQVRVEHYASK--R-TKFIMAHDSRIACFALTQDGQLL 273 (321)
Q Consensus 198 iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~-~~la~sGs~dg~V~i~d~~~~--~-~~~l~~H~~~V~~vafspdg~~l 273 (321)
++|+.+...+.-++...-|..++.+...+|. ..+|++-..+|.+.|+|-... + ...-+-|.++|.++.+++.+..+
T Consensus 80 vfDvEn~DminmiKL~~lPg~a~wv~skGd~~s~IAVs~~~sg~i~VvD~~~d~~q~~~fkklH~sPV~~i~y~qa~Ds~ 159 (558)
T KOG0882|consen 80 VFDVENFDMINMIKLVDLPGFAEWVTSKGDKISLIAVSLFKSGKIFVVDGFGDFCQDGYFKKLHFSPVKKIRYNQAGDSA 159 (558)
T ss_pred EEEeeccchhhhcccccCCCceEEecCCCCeeeeEEeecccCCCcEEECCcCCcCccceecccccCceEEEEeeccccce
Confidence 9999887777666665555556555444432 467777778889999775432 2 23445699999999999999999
Q ss_pred EEEeCCCcEEEEEEcC
Q 020784 274 ATSSTKGTLVRIFNTL 289 (321)
Q Consensus 274 as~S~Dgt~IrIWd~~ 289 (321)
+|....|. |.-|...
T Consensus 160 vSiD~~gm-VEyWs~e 174 (558)
T KOG0882|consen 160 VSIDISGM-VEYWSAE 174 (558)
T ss_pred eeccccce-eEeecCC
Confidence 98887787 9999887
No 348
>PF14583 Pectate_lyase22: Oligogalacturonate lyase; PDB: 3C5M_C 3PE7_A.
Probab=96.39 E-value=0.81 Score=42.37 Aligned_cols=59 Identities=12% Similarity=0.222 Sum_probs=31.3
Q ss_pred eeEEEECCCCCEEEEEeCCC---------------cEEEEEEcCCCcEEEEEe--------CCCc---ceeEEEeecCce
Q 020784 261 IACFALTQDGQLLATSSTKG---------------TLVRIFNTLDGTLLQEEC--------CPSI---SAQSGLWLSSAW 314 (321)
Q Consensus 261 V~~vafspdg~~las~S~Dg---------------t~IrIWd~~tg~~i~~~~--------~g~~---~~~~~~s~d~~~ 314 (321)
..-.--++||++||-=+.|. ..|+||+++.++...-.+ .++. -...+|++|++|
T Consensus 285 ~~H~~ss~Dg~L~vGDG~d~p~~v~~~~~~~~~~~p~i~~~~~~~~~~~~l~~h~~sw~v~~~~~q~~hPhp~FSPDgk~ 364 (386)
T PF14583_consen 285 CSHFMSSPDGKLFVGDGGDAPVDVADAGGYKIENDPWIYLFDVEAGRFRKLARHDTSWKVLDGDRQVTHPHPSFSPDGKW 364 (386)
T ss_dssp EEEEEE-TTSSEEEEEE-------------------EEEEEETTTTEEEEEEE-------BTTBSSTT----EE-TTSSE
T ss_pred eeeeEEcCCCCEEEecCCCCCccccccccceecCCcEEEEeccccCceeeeeeccCcceeecCCCccCCCCCccCCCCCE
Confidence 33444469999987633332 147789998877542221 1111 234599999999
Q ss_pred EEEee
Q 020784 315 LRVLR 319 (321)
Q Consensus 315 la~~~ 319 (321)
+...+
T Consensus 365 VlF~S 369 (386)
T PF14583_consen 365 VLFRS 369 (386)
T ss_dssp EEEEE
T ss_pred EEEEC
Confidence 86643
No 349
>KOG2114 consensus Vacuolar assembly/sorting protein PEP5/VPS11 [Intracellular trafficking, secretion, and vesicular transport]
Probab=96.37 E-value=0.26 Score=49.37 Aligned_cols=148 Identities=18% Similarity=0.231 Sum_probs=81.6
Q ss_pred EEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEee-CCc-eeEEEEeCC--eEEEE-EC-C----EEEEEEc
Q 020784 132 VVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSF-RSE-VRSVKLRRD--RIIVV-LE-Q----KIFVYNF 201 (321)
Q Consensus 132 ~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~-~~~-v~~v~~~~~--~~~~~-~~-~----~I~iwd~ 201 (321)
.-+++..+..+++++ .+|.|.+.+-. .+.+..++. ... |..+....+ .++.. .+ + .++||++
T Consensus 28 isc~~s~~~~vvigt-------~~G~V~~Ln~s-~~~~~~fqa~~~siv~~L~~~~~~~~L~sv~Ed~~~np~llkiw~l 99 (933)
T KOG2114|consen 28 ISCCSSSTGSVVIGT-------ADGRVVILNSS-FQLIRGFQAYEQSIVQFLYILNKQNFLFSVGEDEQGNPVLLKIWDL 99 (933)
T ss_pred eeEEcCCCceEEEee-------ccccEEEeccc-ceeeehheecchhhhhHhhcccCceEEEEEeecCCCCceEEEEecc
Confidence 334556667777766 56777666532 223244432 223 444544444 33332 22 2 7999999
Q ss_pred CC------cEEE--EEEecc-----CCCCceEEEeeCCCceEEEeecCCCCcEEEEe--e-CCcceEEee--ccccceeE
Q 020784 202 AD------LKLL--HQIETI-----ANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEH--Y-ASKRTKFIM--AHDSRIAC 263 (321)
Q Consensus 202 ~~------~~~~--~~l~~~-----~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d--~-~~~~~~~l~--~H~~~V~~ 263 (321)
.. .+++ +.+-++ ..+..+++++.+ -..+|+ |..||.|..+. . +.+-.+..- .-..+|+.
T Consensus 100 ek~~~n~sP~c~~~~ri~~~~np~~~~p~s~l~Vs~~--l~~Iv~-Gf~nG~V~~~~GDi~RDrgsr~~~~~~~~~pITg 176 (933)
T KOG2114|consen 100 EKVDKNNSPQCLYEHRIFTIKNPTNPSPASSLAVSED--LKTIVC-GFTNGLVICYKGDILRDRGSRQDYSHRGKEPITG 176 (933)
T ss_pred cccCCCCCcceeeeeeeeccCCCCCCCcceEEEEEcc--ccEEEE-EecCcEEEEEcCcchhccccceeeeccCCCCcee
Confidence 53 2334 122222 233445566554 467775 99999988742 2 222223322 33578999
Q ss_pred EEECCCCCEEEEEeCCCcEEEEEEcCCC
Q 020784 264 FALTQDGQLLATSSTKGTLVRIFNTLDG 291 (321)
Q Consensus 264 vafspdg~~las~S~Dgt~IrIWd~~tg 291 (321)
++|.-++..+.=+..-.. |.+|.+...
T Consensus 177 L~~~~d~~s~lFv~Tt~~-V~~y~l~gr 203 (933)
T KOG2114|consen 177 LALRSDGKSVLFVATTEQ-VMLYSLSGR 203 (933)
T ss_pred eEEecCCceeEEEEecce-eEEEEecCC
Confidence 999988876222222444 999999843
No 350
>KOG1832 consensus HIV-1 Vpr-binding protein [Cell cycle control, cell division, chromosome partitioning]
Probab=96.27 E-value=0.0041 Score=61.84 Aligned_cols=170 Identities=8% Similarity=0.001 Sum_probs=111.0
Q ss_pred cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCC-ceeEEEEeCCe---EEEEE-CC-EEEEE
Q 020784 126 RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRS-EVRSVKLRRDR---IIVVL-EQ-KIFVY 199 (321)
Q Consensus 126 ~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~-~v~~v~~~~~~---~~~~~-~~-~I~iw 199 (321)
|+....+++++.+.+.+++.+ ..|.|+++++.+|.......++. .|+-+.-+.++ +..++ .. -..+|
T Consensus 1100 ~~~~fTc~afs~~~~hL~vG~-------~~Geik~~nv~sG~~e~s~ncH~SavT~vePs~dgs~~Ltsss~S~PlsaLW 1172 (1516)
T KOG1832|consen 1100 ETALFTCIAFSGGTNHLAVGS-------HAGEIKIFNVSSGSMEESVNCHQSAVTLVEPSVDGSTQLTSSSSSSPLSALW 1172 (1516)
T ss_pred cccceeeEEeecCCceEEeee-------ccceEEEEEccCccccccccccccccccccccCCcceeeeeccccCchHHHh
Confidence 456778888888889998877 56999999999998766666554 67777766553 22222 23 67799
Q ss_pred EcC-CcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEE-eec---cccceeEEEECCCCCEE
Q 020784 200 NFA-DLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKF-IMA---HDSRIACFALTQDGQLL 273 (321)
Q Consensus 200 d~~-~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~-l~~---H~~~V~~vafspdg~~l 273 (321)
++. .+...++|... .++-|+... +.-+ .|.....+.|||.++.. +.+ |.+ -...=++..|||+..++
T Consensus 1173 ~~~s~~~~~Hsf~ed----~~vkFsn~~--q~r~-~gt~~d~a~~YDvqT~~~l~tylt~~~~~~y~~n~a~FsP~D~LI 1245 (1516)
T KOG1832|consen 1173 DASSTGGPRHSFDED----KAVKFSNSL--QFRA-LGTEADDALLYDVQTCSPLQTYLTDTVTSSYSNNLAHFSPCDTLI 1245 (1516)
T ss_pred ccccccCcccccccc----ceeehhhhH--HHHH-hcccccceEEEecccCcHHHHhcCcchhhhhhccccccCCCcceE
Confidence 984 56666776543 244555442 2222 25555678889988753 222 221 22233788999999887
Q ss_pred EEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeEEEeecCceE
Q 020784 274 ATSSTKGTLVRIFNTLDGTLLQEECCPSISAQSGLWLSSAWL 315 (321)
Q Consensus 274 as~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~s~d~~~l 315 (321)
. +||- +||++..+.++.|.+-+....-.|-++|.-+
T Consensus 1246 l---ndGv---LWDvR~~~aIh~FD~ft~~~~G~FHP~g~eV 1281 (1516)
T KOG1832|consen 1246 L---NDGV---LWDVRIPEAIHRFDQFTDYGGGGFHPSGNEV 1281 (1516)
T ss_pred e---eCce---eeeeccHHHHhhhhhheecccccccCCCceE
Confidence 6 5766 8999998888887654433333566666443
No 351
>smart00320 WD40 WD40 repeats. Note that these repeats are permuted with respect to the structural repeats (blades) of the beta propeller domain.
Probab=96.25 E-value=0.0087 Score=34.13 Aligned_cols=30 Identities=17% Similarity=0.488 Sum_probs=25.1
Q ss_pred CCCCCeEEEEEcCCCCEEEEEcCCc-EEEEE
Q 020784 83 SPPPTLLHISFNQDHGCFAAGTDHG-FRIYN 112 (321)
Q Consensus 83 ~~~~~V~~v~fs~dg~~lasg~~~g-v~vw~ 112 (321)
.|...|+++.|++++.++++|+.++ +++|+
T Consensus 10 ~~~~~i~~~~~~~~~~~~~~~~~d~~~~~~~ 40 (40)
T smart00320 10 GHTGPVTSVAFSPDGKYLASASDDGTIKLWD 40 (40)
T ss_pred ecCCceeEEEECCCCCEEEEecCCCeEEEcC
Confidence 4566899999999999999998866 77885
No 352
>KOG4640 consensus Anaphase-promoting complex (APC), subunit 4 [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=96.23 E-value=0.033 Score=53.60 Aligned_cols=92 Identities=13% Similarity=0.152 Sum_probs=70.1
Q ss_pred CCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceE-EEEEecCCCeEEEEeCCCCCCCCCCcEEEEeC
Q 020784 86 PTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIG-VVEMLFRCNILALVGGGPDPQYPLNKVMIWDD 163 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~-~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~ 163 (321)
..|.-+.|+|.-.+||.+..+| +.+..+. ..++....+ ++..+. ..+|.++++.++++- .||+|++-|+
T Consensus 21 ~~i~~~ewnP~~dLiA~~t~~gelli~R~n-~qRlwtip~-p~~~v~~sL~W~~DGkllaVg~-------kdG~I~L~Dv 91 (665)
T KOG4640|consen 21 INIKRIEWNPKMDLIATRTEKGELLIHRLN-WQRLWTIPI-PGENVTASLCWRPDGKLLAVGF-------KDGTIRLHDV 91 (665)
T ss_pred cceEEEEEcCccchhheeccCCcEEEEEec-cceeEeccC-CCCccceeeeecCCCCEEEEEe-------cCCeEEEEEc
Confidence 3788999999999999999988 6666666 444444443 355555 889999999998876 7899999999
Q ss_pred CCCcEEEE--EeeCCceeEEEEeCC
Q 020784 164 HQSRCIGE--LSFRSEVRSVKLRRD 186 (321)
Q Consensus 164 ~~~~~~~~--~~~~~~v~~v~~~~~ 186 (321)
.++..+.. +.....|.++.|.+.
T Consensus 92 e~~~~l~~~~~s~e~~is~~~w~~~ 116 (665)
T KOG4640|consen 92 EKGGRLVSFLFSVETDISKGIWDRI 116 (665)
T ss_pred cCCCceeccccccccchheeecccc
Confidence 99987776 344456777777643
No 353
>KOG2079 consensus Vacuolar assembly/sorting protein VPS8 [Intracellular trafficking, secretion, and vesicular transport]
Probab=95.95 E-value=0.017 Score=58.68 Aligned_cols=71 Identities=18% Similarity=0.268 Sum_probs=52.7
Q ss_pred eEEEeecCCCCcEEEEeeCCc--ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCC
Q 020784 229 LVLVCPGLQKGQVRVEHYASK--RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPS 301 (321)
Q Consensus 229 ~~la~sGs~dg~V~i~d~~~~--~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~ 301 (321)
..+++ |+..|.|...|+... +...=..-.++|++++|+.||.+++.|=.+|. |.+||+..++.++.+..+.
T Consensus 100 ~~ivi-~Ts~ghvl~~d~~~nL~~~~~ne~v~~~Vtsvafn~dg~~l~~G~~~G~-V~v~D~~~~k~l~~i~e~~ 172 (1206)
T KOG2079|consen 100 VPIVI-GTSHGHVLLSDMTGNLGPLHQNERVQGPVTSVAFNQDGSLLLAGLGDGH-VTVWDMHRAKILKVITEHG 172 (1206)
T ss_pred eeEEE-EcCchhhhhhhhhcccchhhcCCccCCcceeeEecCCCceeccccCCCc-EEEEEccCCcceeeeeecC
Confidence 45664 788888887554332 21221223578999999999999999988998 9999999999988876443
No 354
>PF05694 SBP56: 56kDa selenium binding protein (SBP56); InterPro: IPR008826 This family consists of several eukaryotic selenium binding proteins as well as three sequences from archaea. The exact function of this protein is unknown although it is thought that SBP56 participates in late stages of intra-Golgi protein transport []. The Lotus japonicus homologue of SBP56, LjSBP is thought to have more than one physiological role and can be implicated in controlling the oxidation/reduction status of target proteins in vesicular Golgi transport [].; GO: 0008430 selenium binding; PDB: 2ECE_A.
Probab=95.94 E-value=1.5 Score=41.23 Aligned_cols=223 Identities=15% Similarity=0.110 Sum_probs=98.4
Q ss_pred CCCEEEEEcCC--cEEEEEecCC--ceeEEeeee----c-CCce---EEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeC
Q 020784 96 DHGCFAAGTDH--GFRIYNCDPF--REIFRRDFE----R-GGGI---GVVEMLFRCNILALVGGGPDPQYPLNKVMIWDD 163 (321)
Q Consensus 96 dg~~lasg~~~--gv~vw~~~~~--~~~~~~~~~----~-~~~v---~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~ 163 (321)
+.++|+..+-+ .|.|.|+.+. +-...+... + ...+ -.+.+.++++.++++=|+.+. -..+.+.+.|-
T Consensus 86 ~Rr~Li~PgL~SsrIyviD~~~dPr~P~l~KvIe~~ev~~k~g~s~PHT~Hclp~G~imIS~lGd~~G-~g~Ggf~llD~ 164 (461)
T PF05694_consen 86 ERRYLILPGLRSSRIYVIDTKTDPRKPRLHKVIEPEEVFEKTGLSRPHTVHCLPDGRIMISALGDADG-NGPGGFVLLDG 164 (461)
T ss_dssp -S-EEEEEBTTT--EEEEE--S-TTS-EEEEEE-HHHHHHHH-EEEEEEEEE-SS--EEEEEEEETTS--S--EEEEE-T
T ss_pred cCCcEEeeeeccCcEEEEECCCCCCCCceEeeeCHHHHHhhcCCCCCceeeecCCccEEEEeccCCCC-CCCCcEEEEcC
Confidence 46788877753 3667787532 222222210 0 0111 123445677777666443322 23577888888
Q ss_pred CCCcEEEEEeeCC--ce--eEEEEeCCe--EEEE---------------------ECCEEEEEEcCCcEEEEEEeccCCC
Q 020784 164 HQSRCIGELSFRS--EV--RSVKLRRDR--IIVV---------------------LEQKIFVYNFADLKLLHQIETIANP 216 (321)
Q Consensus 164 ~~~~~~~~~~~~~--~v--~~v~~~~~~--~~~~---------------------~~~~I~iwd~~~~~~~~~l~~~~~~ 216 (321)
++.+.....+... .. +.+-+++.+ ++.. .+.++.+||+.+.+.++++......
T Consensus 165 ~tf~v~g~We~~~~~~~~gYDfw~qpr~nvMiSSeWg~P~~~~~Gf~~~d~~~~~yG~~l~vWD~~~r~~~Q~idLg~~g 244 (461)
T PF05694_consen 165 ETFEVKGRWEKDRGPQPFGYDFWYQPRHNVMISSEWGAPSMFEKGFNPEDLEAGKYGHSLHVWDWSTRKLLQTIDLGEEG 244 (461)
T ss_dssp TT--EEEE--SB-TT------EEEETTTTEEEE-B---HHHHTT---TTTHHHH-S--EEEEEETTTTEEEEEEES-TTE
T ss_pred ccccccceeccCCCCCCCCCCeEEcCCCCEEEEeccCChhhcccCCChhHhhcccccCeEEEEECCCCcEeeEEecCCCC
Confidence 8877766554322 22 233344332 2211 1258999999999999999876432
Q ss_pred C--ceEEEeeCCCceEEEeecCC-CCcE-EEEeeCCc-----ceEEeec-----------------cccceeEEEECCCC
Q 020784 217 K--GLCAVSQGVGSLVLVCPGLQ-KGQV-RVEHYASK-----RTKFIMA-----------------HDSRIACFALTQDG 270 (321)
Q Consensus 217 ~--~~~~~s~~~d~~~la~sGs~-dg~V-~i~d~~~~-----~~~~l~~-----------------H~~~V~~vafspdg 270 (321)
. .-+.+..+++...=. .|.. ...| +++....+ .+..+.. -..-|+.|.+|.|.
T Consensus 245 ~~pLEvRflH~P~~~~gF-vg~aLss~i~~~~k~~~g~W~a~kVi~ip~~~v~~~~lp~ml~~~~~~P~LitDI~iSlDD 323 (461)
T PF05694_consen 245 QMPLEVRFLHDPDANYGF-VGCALSSSIWRFYKDDDGEWAAEKVIDIPAKKVEGWILPEMLKPFGAVPPLITDILISLDD 323 (461)
T ss_dssp EEEEEEEE-SSTT--EEE-EEEE--EEEEEEEE-ETTEEEEEEEEEE--EE--SS---GGGGGG-EE------EEE-TTS
T ss_pred CceEEEEecCCCCccceE-EEEeccceEEEEEEcCCCCeeeeEEEECCCcccCcccccccccccccCCCceEeEEEccCC
Confidence 2 235666666543221 1221 2233 33332221 1112211 12347999999999
Q ss_pred CEEEEEeC-CCcEEEEEEcCC---CcEEEEEeCCCcc-----------------eeEEEeecCceEEEeecC
Q 020784 271 QLLATSST-KGTLVRIFNTLD---GTLLQEECCPSIS-----------------AQSGLWLSSAWLRVLRTL 321 (321)
Q Consensus 271 ~~las~S~-Dgt~IrIWd~~t---g~~i~~~~~g~~~-----------------~~~~~s~d~~~la~~~~~ 321 (321)
++|-...+ +|. ||-||+.. -+++.+...|... .-+++|.||+.|.+..-|
T Consensus 324 rfLYvs~W~~Gd-vrqYDISDP~~Pkl~gqv~lGG~~~~~~~~~v~g~~l~GgPqMvqlS~DGkRlYvTnSL 394 (461)
T PF05694_consen 324 RFLYVSNWLHGD-VRQYDISDPFNPKLVGQVFLGGSIRKGDHPVVKGKRLRGGPQMVQLSLDGKRLYVTNSL 394 (461)
T ss_dssp -EEEEEETTTTE-EEEEE-SSTTS-EEEEEEE-BTTTT-B--TTS------S----EEE-TTSSEEEEE---
T ss_pred CEEEEEcccCCc-EEEEecCCCCCCcEEeEEEECcEeccCCCccccccccCCCCCeEEEccCCeEEEEEeec
Confidence 88766555 777 99999986 3566666555432 335899999999886543
No 355
>PF00780 CNH: CNH domain; InterPro: IPR001180 Based on sequence similarities a domain of homology has been identified in the following proteins []: Citron and Citron kinase. These two proteins interact with the GTP-bound forms of the small GTPases Rho and Rac but not with Cdc42. Myotonic dystrophy kinase-related Cdc42-binding kinase (MRCKalpha). This serine/threonine kinase interacts with the GTP-bound form of the small GTPase Cdc42 and to a lesser extent with that of Rac. NCK Interacting Kinase (NIK), a serine/threonine protein kinase. ROM-1 and ROM-2, from yeast. These proteins are GDP/GTP exchange proteins (GEPs) for the small GTP binding protein Rho1. This domain, called the citron homology domain, is often found after cysteine rich and pleckstrin homology (PH) domains at the C-terminal end of the proteins []. It acts as a regulatory domain and could be involved in macromolecular interactions [, ].; GO: 0005083 small GTPase regulator activity
Probab=95.94 E-value=1.1 Score=39.55 Aligned_cols=140 Identities=19% Similarity=0.260 Sum_probs=81.1
Q ss_pred CCCCEEEEEcCCcEEEEEe-cCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEE---
Q 020784 95 QDHGCFAAGTDHGFRIYNC-DPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIG--- 170 (321)
Q Consensus 95 ~dg~~lasg~~~gv~vw~~-~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~--- 170 (321)
..++.|+.|.++|+.+++. ...+...... ...|..+.+.++-+.+++.+ |+.+.++|+..-....
T Consensus 5 ~~~~~L~vGt~~Gl~~~~~~~~~~~~~i~~---~~~I~ql~vl~~~~~llvLs--------d~~l~~~~L~~l~~~~~~~ 73 (275)
T PF00780_consen 5 SWGDRLLVGTEDGLYVYDLSDPSKPTRILK---LSSITQLSVLPELNLLLVLS--------DGQLYVYDLDSLEPVSTSA 73 (275)
T ss_pred cCCCEEEEEECCCEEEEEecCCccceeEee---cceEEEEEEecccCEEEEEc--------CCccEEEEchhhccccccc
Confidence 4578899999999889998 3333322222 34588888888888888776 5889999976544332
Q ss_pred ------------EEeeCCceeEEE----E-eCCeEEEEECCEEEEEEcCC----c-EEEEEEeccCCCCceEEEeeCCCc
Q 020784 171 ------------ELSFRSEVRSVK----L-RRDRIIVVLEQKIFVYNFAD----L-KLLHQIETIANPKGLCAVSQGVGS 228 (321)
Q Consensus 171 ------------~~~~~~~v~~v~----~-~~~~~~~~~~~~I~iwd~~~----~-~~~~~l~~~~~~~~~~~~s~~~d~ 228 (321)
.+.....+...+ . ....++++..++|.+|.... . +.++.+.....+ ..+++. +
T Consensus 74 ~~~~~~~~~~~~~~~~~~~v~~f~~~~~~~~~~~L~va~kk~i~i~~~~~~~~~f~~~~ke~~lp~~~-~~i~~~--~-- 148 (275)
T PF00780_consen 74 PLAFPKSRSLPTKLPETKGVSFFAVNGGHEGSRRLCVAVKKKILIYEWNDPRNSFSKLLKEISLPDPP-SSIAFL--G-- 148 (275)
T ss_pred cccccccccccccccccCCeeEEeeccccccceEEEEEECCEEEEEEEECCcccccceeEEEEcCCCc-EEEEEe--C--
Confidence 111122333333 1 11246666778999988854 2 455666554332 233333 2
Q ss_pred eEEEeecCCCCcEEEEeeCCcceE
Q 020784 229 LVLVCPGLQKGQVRVEHYASKRTK 252 (321)
Q Consensus 229 ~~la~sGs~dg~V~i~d~~~~~~~ 252 (321)
..+++ |..+ ...+.|+.++...
T Consensus 149 ~~i~v-~~~~-~f~~idl~~~~~~ 170 (275)
T PF00780_consen 149 NKICV-GTSK-GFYLIDLNTGSPS 170 (275)
T ss_pred CEEEE-EeCC-ceEEEecCCCCce
Confidence 34443 5544 4555666544433
No 356
>COG3386 Gluconolactonase [Carbohydrate transport and metabolism]
Probab=95.91 E-value=0.91 Score=41.08 Aligned_cols=134 Identities=7% Similarity=-0.022 Sum_probs=74.9
Q ss_pred CCcEEEEeCCCCcEEEEEeeCCceeE-EEEeCCeEEEEECCEEEEEEcCCcEEEEEEecc---CCCCceEEEeeCCCceE
Q 020784 155 LNKVMIWDDHQSRCIGELSFRSEVRS-VKLRRDRIIVVLEQKIFVYNFADLKLLHQIETI---ANPKGLCAVSQGVGSLV 230 (321)
Q Consensus 155 d~~v~iWD~~~~~~~~~~~~~~~v~~-v~~~~~~~~~~~~~~I~iwd~~~~~~~~~l~~~---~~~~~~~~~s~~~d~~~ 230 (321)
.+.|.-||..+++.. .+...+.+.+ ..++....+++.+..+++++..++..+..+... ......-..-.++++.+
T Consensus 46 ~~~i~r~~~~~g~~~-~~~~p~~~~~~~~~d~~g~Lv~~~~g~~~~~~~~~~~~t~~~~~~~~~~~~r~ND~~v~pdG~~ 124 (307)
T COG3386 46 GGRIHRLDPETGKKR-VFPSPGGFSSGALIDAGGRLIACEHGVRLLDPDTGGKITLLAEPEDGLPLNRPNDGVVDPDGRI 124 (307)
T ss_pred CCeEEEecCCcCceE-EEECCCCcccceeecCCCeEEEEccccEEEeccCCceeEEeccccCCCCcCCCCceeEcCCCCE
Confidence 367777877765432 3444444444 345667788888888888888665553333221 11122223333445555
Q ss_pred EEeecC-----C-----CCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcC
Q 020784 231 LVCPGL-----Q-----KGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 231 la~sGs-----~-----dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~ 289 (321)
-+..-. . -|.|+..+-.......+..|-..-+.|||||||+.|-.+-.....|.-|++.
T Consensus 125 wfgt~~~~~~~~~~~~~~G~lyr~~p~g~~~~l~~~~~~~~NGla~SpDg~tly~aDT~~~~i~r~~~d 193 (307)
T COG3386 125 WFGDMGYFDLGKSEERPTGSLYRVDPDGGVVRLLDDDLTIPNGLAFSPDGKTLYVADTPANRIHRYDLD 193 (307)
T ss_pred EEeCCCccccCccccCCcceEEEEcCCCCEEEeecCcEEecCceEECCCCCEEEEEeCCCCeEEEEecC
Confidence 542222 1 1223323322334555666677789999999997776664443337677665
No 357
>COG3391 Uncharacterized conserved protein [Function unknown]
Probab=95.90 E-value=1.5 Score=40.97 Aligned_cols=176 Identities=15% Similarity=0.097 Sum_probs=115.6
Q ss_pred EEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCC--eEEEEE----CCEEEEEEcCCcEE
Q 020784 133 VEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRD--RIIVVL----EQKIFVYNFADLKL 206 (321)
Q Consensus 133 v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~--~~~~~~----~~~I~iwd~~~~~~ 206 (321)
+.....++.+..... .++.|.+.|..+...............+.+.++ .++++. .+++-+.|-.+.+.
T Consensus 79 i~v~~~~~~vyv~~~------~~~~v~vid~~~~~~~~~~~vG~~P~~~~~~~~~~~vYV~n~~~~~~~vsvid~~t~~~ 152 (381)
T COG3391 79 VAVNPAGNKVYVTTG------DSNTVSVIDTATNTVLGSIPVGLGPVGLAVDPDGKYVYVANAGNGNNTVSVIDAATNKV 152 (381)
T ss_pred eeeCCCCCeEEEecC------CCCeEEEEcCcccceeeEeeeccCCceEEECCCCCEEEEEecccCCceEEEEeCCCCeE
Confidence 344555554444432 358899999888887777766656667777654 566653 35888889888888
Q ss_pred EEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEE-----eeccccceeEEEECCCCCEEEEEeC---
Q 020784 207 LHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKF-----IMAHDSRIACFALTQDGQLLATSST--- 278 (321)
Q Consensus 207 ~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~-----l~~H~~~V~~vafspdg~~las~S~--- 278 (321)
+.++.....+ .-+++.+ ++..+.+.-..+++|.+.+.+...+.. ...-......++++|+|.++-..-.
T Consensus 153 ~~~~~vG~~P-~~~a~~p--~g~~vyv~~~~~~~v~vi~~~~~~v~~~~~~~~~~~~~~P~~i~v~~~g~~~yV~~~~~~ 229 (381)
T COG3391 153 TATIPVGNTP-TGVAVDP--DGNKVYVTNSDDNTVSVIDTSGNSVVRGSVGSLVGVGTGPAGIAVDPDGNRVYVANDGSG 229 (381)
T ss_pred EEEEecCCCc-ceEEECC--CCCeEEEEecCCCeEEEEeCCCcceeccccccccccCCCCceEEECCCCCEEEEEeccCC
Confidence 8886655545 3344444 445333335678899998866554442 1222344678999999985544332
Q ss_pred CCcEEEEEEcCCCcEEEE-EeCCC-cceeEEEeecCceEEEe
Q 020784 279 KGTLVRIFNTLDGTLLQE-ECCPS-ISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 279 Dgt~IrIWd~~tg~~i~~-~~~g~-~~~~~~~s~d~~~la~~ 318 (321)
|++ +.+.|..++..... +..+. ....+.+.++|+++-++
T Consensus 230 ~~~-v~~id~~~~~v~~~~~~~~~~~~~~v~~~p~g~~~yv~ 270 (381)
T COG3391 230 SNN-VLKIDTATGNVTATDLPVGSGAPRGVAVDPAGKAAYVA 270 (381)
T ss_pred Cce-EEEEeCCCceEEEeccccccCCCCceeECCCCCEEEEE
Confidence 257 99999999998876 33333 35566888999887775
No 358
>KOG1897 consensus Damage-specific DNA binding complex, subunit DDB1 [Replication, recombination and repair]
Probab=95.81 E-value=2.7 Score=43.19 Aligned_cols=195 Identities=14% Similarity=0.229 Sum_probs=114.3
Q ss_pred EEEcCC--CCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCC-------CCCCCcEEEE
Q 020784 91 ISFNQD--HGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDP-------QYPLNKVMIW 161 (321)
Q Consensus 91 v~fs~d--g~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~-------~~~d~~v~iW 161 (321)
|.|+.+ ...|+.+..+++++..++..+.++.++..-+.....++.......+++.+....- ...-..++++
T Consensus 676 c~f~s~a~~d~l~~~~~~~l~i~tid~iqkl~irtvpl~~~prrI~~q~~sl~~~v~s~r~e~~~~~~~ee~~~s~l~vl 755 (1096)
T KOG1897|consen 676 CPFNSDAYPDSLASANGGALTIGTIDEIQKLHIRTVPLGESPRRICYQESSLTFGVLSNRIESSAEYYGEEYEVSFLRVL 755 (1096)
T ss_pred cccccccCCceEEEecCCceEEEEecchhhcceeeecCCCChhheEecccceEEEEEecccccchhhcCCcceEEEEEEe
Confidence 446655 3578888888888888877766655553212233333443333334433321110 0011348899
Q ss_pred eCCCCcEEEEEeeCC-----ceeEEEEeCC---eEEEEEC-----------CEEEEEEcCCcEEEEEEeccCCCCceEEE
Q 020784 162 DDHQSRCIGELSFRS-----EVRSVKLRRD---RIIVVLE-----------QKIFVYNFADLKLLHQIETIANPKGLCAV 222 (321)
Q Consensus 162 D~~~~~~~~~~~~~~-----~v~~v~~~~~---~~~~~~~-----------~~I~iwd~~~~~~~~~l~~~~~~~~~~~~ 222 (321)
|-++.+.+...++.. .+.++.|+.+ .+++++. |.|.+|.+...+.++.+..+.-...+.++
T Consensus 756 D~nTf~vl~~hef~~~E~~~Si~s~~~~~d~~t~~vVGT~~v~Pde~ep~~GRIivfe~~e~~~L~~v~e~~v~Gav~aL 835 (1096)
T KOG1897|consen 756 DQNTFEVLSSHEFERNETALSIISCKFTDDPNTYYVVGTGLVYPDENEPVNGRIIVFEFEELNSLELVAETVVKGAVYAL 835 (1096)
T ss_pred cCCceeEEeeccccccceeeeeeeeeecCCCceEEEEEEEeeccCCCCcccceEEEEEEecCCceeeeeeeeeccceeeh
Confidence 988887766554432 3444557654 3555542 68888888663333333322222223333
Q ss_pred eeCCCceEEEeecCCCCcEEEEeeCCc-ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 223 SQGVGSLVLVCPGLQKGQVRVEHYASK-RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 223 s~~~d~~~la~sGs~dg~V~i~d~~~~-~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
.. -++.++| +-+..|+++++..+ .+..-..|..++..+.+.-.|..+|.|.-=+. |.+-..+.
T Consensus 836 ~~-fngkllA---~In~~vrLye~t~~~eLr~e~~~~~~~~aL~l~v~gdeI~VgDlm~S-itll~y~~ 899 (1096)
T KOG1897|consen 836 VE-FNGKLLA---GINQSVRLYEWTTERELRIECNISNPIIALDLQVKGDEIAVGDLMRS-ITLLQYKG 899 (1096)
T ss_pred hh-hCCeEEE---ecCcEEEEEEccccceehhhhcccCCeEEEEEEecCcEEEEeeccce-EEEEEEec
Confidence 22 1347777 44568999988877 45555678889999999989999999876666 66655443
No 359
>KOG1008 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=95.79 E-value=0.0025 Score=61.12 Aligned_cols=195 Identities=13% Similarity=0.104 Sum_probs=103.7
Q ss_pred CCeEEEEEcCCCC--EEEEEcCCc-EEEEEecCC---ceeEEeeeecCCceEEEEEec-CCCeEEEEeCCCCCCCCCCcE
Q 020784 86 PTLLHISFNQDHG--CFAAGTDHG-FRIYNCDPF---REIFRRDFERGGGIGVVEMLF-RCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 86 ~~V~~v~fs~dg~--~lasg~~~g-v~vw~~~~~---~~~~~~~~~~~~~v~~v~~~~-~~~~~~~~sg~~~~~~~d~~v 158 (321)
..+.|++++-+.+ .++.|...| |.+-.+... ..++... +.......+|.. +.+.+|..-..- =.|-.+
T Consensus 57 qy~kcva~~y~~d~cIlavG~atG~I~l~s~r~~hdSs~E~tp~--~ar~Ct~lAwneLDtn~LAagldkh---rnds~~ 131 (783)
T KOG1008|consen 57 QYVKCVASFYGNDRCILAVGSATGNISLLSVRHPHDSSAEVTPG--YARPCTSLAWNELDTNHLAAGLDKH---RNDSSL 131 (783)
T ss_pred CCceeehhhcCCchhhhhhccccCceEEeecCCcccccceeccc--ccccccccccccccHHHHHhhhhhh---cccCCc
Confidence 3688888776544 677888766 545543211 1111111 122333444432 344444432111 146779
Q ss_pred EEEeCCCCc--EEEEEeeC----CceeEEEEeCCeEEEE---ECCEEEEEEcCC-cEEEEEEeccCCCCceEEEeeCCCc
Q 020784 159 MIWDDHQSR--CIGELSFR----SEVRSVKLRRDRIIVV---LEQKIFVYNFAD-LKLLHQIETIANPKGLCAVSQGVGS 228 (321)
Q Consensus 159 ~iWD~~~~~--~~~~~~~~----~~v~~v~~~~~~~~~~---~~~~I~iwd~~~-~~~~~~l~~~~~~~~~~~~s~~~d~ 228 (321)
+|||..++- ......+. ....++||..+...+. +...++++|++. ......+.+. .+.-..+.+- ..
T Consensus 132 ~Iwdi~s~ltvPke~~~fs~~~l~gqns~cwlrd~klvlaGm~sr~~~ifdlRqs~~~~~svnTk--~vqG~tVdp~-~~ 208 (783)
T KOG1008|consen 132 KIWDINSLLTVPKESPLFSSSTLDGQNSVCWLRDTKLVLAGMTSRSVHIFDLRQSLDSVSSVNTK--YVQGITVDPF-SP 208 (783)
T ss_pred cceecccccCCCccccccccccccCccccccccCcchhhcccccchhhhhhhhhhhhhhhhhhhh--hcccceecCC-CC
Confidence 999987762 21122221 2344678776543332 345899999973 2222223221 1111222331 23
Q ss_pred eEEEeecCCCCcEEEEee-CC-cceEEeecccc-----ceeEEEECCC-CCEEEEEeCCCcEEEEEEcCC
Q 020784 229 LVLVCPGLQKGQVRVEHY-AS-KRTKFIMAHDS-----RIACFALTQD-GQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 229 ~~la~sGs~dg~V~i~d~-~~-~~~~~l~~H~~-----~V~~vafspd-g~~las~S~Dgt~IrIWd~~t 290 (321)
.+++ ...||.|.+||. .. +.....-.|.. .+..++|.|. ..+||+.+.|...||.+|+..
T Consensus 209 nY~c--s~~dg~iAiwD~~rnienpl~~i~~~~N~~~~~l~~~aycPtrtglla~l~RdS~tIrlydi~~ 276 (783)
T KOG1008|consen 209 NYFC--SNSDGDIAIWDTYRNIENPLQIILRNENKKPKQLFALAYCPTRTGLLAVLSRDSITIRLYDICV 276 (783)
T ss_pred Ccee--ccccCceeeccchhhhccHHHHHhhCCCCcccceeeEEeccCCcchhhhhccCcceEEEecccc
Confidence 6777 467999999994 21 11111112222 3899999986 357888888876699999863
No 360
>PF12894 Apc4_WD40: Anaphase-promoting complex subunit 4 WD40 domain
Probab=95.64 E-value=0.036 Score=35.06 Aligned_cols=29 Identities=24% Similarity=0.442 Sum_probs=25.7
Q ss_pred CCCeEEEEEcCCCCEEEEEcCCc-EEEEEe
Q 020784 85 PPTLLHISFNQDHGCFAAGTDHG-FRIYNC 113 (321)
Q Consensus 85 ~~~V~~v~fs~dg~~lasg~~~g-v~vw~~ 113 (321)
.++|.+++|+|..++||.|+.+| |.||.+
T Consensus 11 ~~~v~~~~w~P~mdLiA~~t~~g~v~v~Rl 40 (47)
T PF12894_consen 11 PSRVSCMSWCPTMDLIALGTEDGEVLVYRL 40 (47)
T ss_pred CCcEEEEEECCCCCEEEEEECCCeEEEEEC
Confidence 35799999999999999999977 778887
No 361
>KOG1645 consensus RING-finger-containing E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=95.49 E-value=0.05 Score=49.70 Aligned_cols=92 Identities=11% Similarity=0.021 Sum_probs=62.7
Q ss_pred EEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcce-EEeeccccceeEEEECCCCCEE-
Q 020784 196 IFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRT-KFIMAHDSRIACFALTQDGQLL- 273 (321)
Q Consensus 196 I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~-~~l~~H~~~V~~vafspdg~~l- 273 (321)
+++.+..+++..+-+..+...+.-+++++...|.+. .++-+.+|+|.|+.+... .++.+| ..+++++|.-|...+
T Consensus 175 v~~l~~~~fkssq~lp~~g~~IrdlafSp~~~GLl~--~asl~nkiki~dlet~~~vssy~a~-~~~wSC~wDlde~h~I 251 (463)
T KOG1645|consen 175 VQKLESHDFKSSQILPGEGSFIRDLAFSPFNEGLLG--LASLGNKIKIMDLETSCVVSSYIAY-NQIWSCCWDLDERHVI 251 (463)
T ss_pred eEEeccCCcchhhcccccchhhhhhccCccccceee--eeccCceEEEEecccceeeeheecc-CCceeeeeccCCccee
Confidence 555555555554444444444555677776544333 478999999999988764 467777 889999999876554
Q ss_pred EEEeCCCcEEEEEEcCCC
Q 020784 274 ATSSTKGTLVRIFNTLDG 291 (321)
Q Consensus 274 as~S~Dgt~IrIWd~~tg 291 (321)
-.|-..|. |.|||++.-
T Consensus 252 YaGl~nG~-VlvyD~R~~ 268 (463)
T KOG1645|consen 252 YAGLQNGM-VLVYDMRQP 268 (463)
T ss_pred EEeccCce-EEEEEccCC
Confidence 44555566 999999864
No 362
>PF00930 DPPIV_N: Dipeptidyl peptidase IV (DPP IV) N-terminal region; InterPro: IPR002469 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This domain defines serine peptidases belonging to MEROPS peptidase family S9 (clan SC), subfamily S9B (dipeptidyl-peptidase IV). The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. This domain is an alignment of the region to the N-terminal side of the active site, which is found in IPR001375 from INTERPRO. CD26 (3.4.14.5 from EC) is also called adenosine deaminase-binding protein (ADA-binding protein) or dipeptidylpeptidase IV (DPP IV ectoenzyme). The exopeptidase cleaves off N-terminal X-Pro or X-Ala dipeptides from polypeptides (dipeptidyl peptidase IV activity). CD26 serves as the costimulatory molecule in T cell activation and is an associated marker of autoimmune diseases, adenosine deaminase-deficiency and HIV pathogenesis. Dipeptidyl peptidase IV (DPP IV) is responsible for the removal of N-terminal dipeptides sequentially from polypeptides having unsubstituted N termini, provided that the penultimate residue is proline. The enzyme catalyses the reaction: Dipeptidyl-Polypeptide + H(2)O = Dipeptide + Polypeptide It is a type II membrane protein that forms a homodimer. CD molecules are leucocyte antigens on cell surfaces. CD antigens nomenclature is updated at Protein Reviews On The Web (http://prow.nci.nih.gov/). ; GO: 0006508 proteolysis, 0016020 membrane; PDB: 2RIP_A 3Q8W_B 2AJL_I 1TKR_B 1TK3_B 3C45_A 2G5P_A 3G0C_D 1R9M_C 1RWQ_A ....
Probab=95.48 E-value=0.069 Score=49.35 Aligned_cols=81 Identities=14% Similarity=0.091 Sum_probs=58.3
Q ss_pred CCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCC-----------------
Q 020784 238 KGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCP----------------- 300 (321)
Q Consensus 238 dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g----------------- 300 (321)
.+.+.|+|+.++....+......+....|||+|+.+|-.. ++. |.++++.+++..+--..|
T Consensus 22 ~~~y~i~d~~~~~~~~l~~~~~~~~~~~~sP~g~~~~~v~-~~n-ly~~~~~~~~~~~lT~dg~~~i~nG~~dwvyeEEv 99 (353)
T PF00930_consen 22 KGDYYIYDIETGEITPLTPPPPKLQDAKWSPDGKYIAFVR-DNN-LYLRDLATGQETQLTTDGEPGIYNGVPDWVYEEEV 99 (353)
T ss_dssp EEEEEEEETTTTEEEESS-EETTBSEEEE-SSSTEEEEEE-TTE-EEEESSTTSEEEESES--TTTEEESB--HHHHHHT
T ss_pred ceeEEEEecCCCceEECcCCccccccceeecCCCeeEEEe-cCc-eEEEECCCCCeEEeccccceeEEcCccceeccccc
Confidence 4567789998887777666678899999999999999886 777 999999888554322223
Q ss_pred -CcceeEEEeecCceEEEeec
Q 020784 301 -SISAQSGLWLSSAWLRVLRT 320 (321)
Q Consensus 301 -~~~~~~~~s~d~~~la~~~~ 320 (321)
.....+-.|+||++||.+|.
T Consensus 100 ~~~~~~~~WSpd~~~la~~~~ 120 (353)
T PF00930_consen 100 FDRRSAVWWSPDSKYLAFLRF 120 (353)
T ss_dssp SSSSBSEEE-TTSSEEEEEEE
T ss_pred cccccceEECCCCCEEEEEEE
Confidence 11234567899999999874
No 363
>KOG3621 consensus WD40 repeat-containing protein [General function prediction only]
Probab=95.32 E-value=0.61 Score=45.76 Aligned_cols=34 Identities=12% Similarity=0.163 Sum_probs=27.2
Q ss_pred CCCCCCeEEEEEcCCCCEEEEEcCCcEE-EEEecC
Q 020784 82 SSPPPTLLHISFNQDHGCFAAGTDHGFR-IYNCDP 115 (321)
Q Consensus 82 ~~~~~~V~~v~fs~dg~~lasg~~~gv~-vw~~~~ 115 (321)
..|+.+|+|++|++||..|.+|...|.. +-.++.
T Consensus 121 ~~~~~rVTal~Ws~~~~k~ysGD~~Gkv~~~~L~s 155 (726)
T KOG3621|consen 121 KSHKCRVTALEWSKNGMKLYSGDSQGKVVLTELDS 155 (726)
T ss_pred ccCCceEEEEEecccccEEeecCCCceEEEEEech
Confidence 3477899999999999999999997744 444554
No 364
>KOG4714 consensus Nucleoporin [Nuclear structure]
Probab=95.28 E-value=0.29 Score=42.45 Aligned_cols=101 Identities=12% Similarity=0.178 Sum_probs=65.3
Q ss_pred CCCEEEEEcC------CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEE
Q 020784 96 DHGCFAAGTD------HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCI 169 (321)
Q Consensus 96 dg~~lasg~~------~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~ 169 (321)
.++++.++.. +..+.|++++.+.+..... ....+..++.++..+.+.+++. .||.+-+||.++....
T Consensus 143 ~~~~i~s~~~g~~n~~d~~~a~~~~p~~t~~~~~~-~~~~v~~l~~hp~qq~~v~cgt------~dg~~~l~d~rn~~~p 215 (319)
T KOG4714|consen 143 HGNSILSGGCGNWNAQDNFYANTLDPIKTLIPSKK-ALDAVTALCSHPAQQHLVCCGT------DDGIVGLWDARNVAMP 215 (319)
T ss_pred cccEEecCCcceEeeccceeeeccccccccccccc-ccccchhhhCCcccccEEEEec------CCCeEEEEEcccccch
Confidence 4555555543 3456888877665433332 2345777777777777766664 4699999999877432
Q ss_pred E-EE-eeCCceeEEEEeCC---eEEEEE-CCEEEEEEcCC
Q 020784 170 G-EL-SFRSEVRSVKLRRD---RIIVVL-EQKIFVYNFAD 203 (321)
Q Consensus 170 ~-~~-~~~~~v~~v~~~~~---~~~~~~-~~~I~iwd~~~ 203 (321)
. .+ .+..++..+.||++ .++.+. ++.+-.||-.+
T Consensus 216 ~S~l~ahk~~i~eV~FHpk~p~~Lft~sedGslw~wdas~ 255 (319)
T KOG4714|consen 216 VSLLKAHKAEIWEVHFHPKNPEHLFTCSEDGSLWHWDAST 255 (319)
T ss_pred HHHHHHhhhhhhheeccCCCchheeEecCCCcEEEEcCCC
Confidence 2 12 24457888999864 566665 57898898764
No 365
>COG3490 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=95.12 E-value=0.68 Score=40.91 Aligned_cols=41 Identities=24% Similarity=0.399 Sum_probs=31.7
Q ss_pred ccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEE
Q 020784 256 AHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQE 296 (321)
Q Consensus 256 ~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~ 296 (321)
+...+|-+|+.+.+..+++-.|-.|...-|||..||.++..
T Consensus 277 ~~anYigsiA~n~~~glV~lTSP~GN~~vi~da~tG~vv~~ 317 (366)
T COG3490 277 AFANYIGSIAANRRDGLVALTSPRGNRAVIWDAATGAVVSE 317 (366)
T ss_pred HHHhhhhheeecccCCeEEEecCCCCeEEEEEcCCCcEEec
Confidence 34567889999977666666666666688999999998764
No 366
>PF10313 DUF2415: Uncharacterised protein domain (DUF2415); InterPro: IPR019417 This entry represents a short (30 residues) domain of unknown function found in a family of fungal proteins. It contains a characteristic DLL sequence motif.
Probab=95.09 E-value=0.11 Score=32.06 Aligned_cols=32 Identities=22% Similarity=0.351 Sum_probs=23.9
Q ss_pred cceeEEEECCCC---CEEEEEeCCCcEEEEEEcCCC
Q 020784 259 SRIACFALTQDG---QLLATSSTKGTLVRIFNTLDG 291 (321)
Q Consensus 259 ~~V~~vafspdg---~~las~S~Dgt~IrIWd~~tg 291 (321)
++|+++.|||+. .+||-+ ++...|.|+|++++
T Consensus 1 GAvR~~kFsP~~~~~DLL~~~-E~~g~vhi~D~R~~ 35 (43)
T PF10313_consen 1 GAVRCCKFSPEPGGNDLLAWA-EHQGRVHIVDTRSN 35 (43)
T ss_pred CCeEEEEeCCCCCcccEEEEE-ccCCeEEEEEcccC
Confidence 479999999854 477755 44445999999964
No 367
>COG3823 Glutamine cyclotransferase [Posttranslational modification, protein turnover, chaperones]
Probab=95.08 E-value=0.96 Score=38.19 Aligned_cols=108 Identities=10% Similarity=0.062 Sum_probs=67.0
Q ss_pred CCCEEEEEcC-C--cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEE
Q 020784 96 DHGCFAAGTD-H--GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGEL 172 (321)
Q Consensus 96 dg~~lasg~~-~--gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~ 172 (321)
||.+|.+.+. + .|++||+.+++.++..... ...+-.=-...-++.+..... .++...++|.++.+++.++
T Consensus 55 ~g~i~esTG~yg~S~ir~~~L~~gq~~~s~~l~-~~~~FgEGit~~gd~~y~LTw------~egvaf~~d~~t~~~lg~~ 127 (262)
T COG3823 55 DGHILESTGLYGFSKIRVSDLTTGQEIFSEKLA-PDTVFGEGITKLGDYFYQLTW------KEGVAFKYDADTLEELGRF 127 (262)
T ss_pred CCEEEEeccccccceeEEEeccCceEEEEeecC-CccccccceeeccceEEEEEe------ccceeEEEChHHhhhhccc
Confidence 4555555554 2 3889999999988877651 011110011112344444443 4688899999999998888
Q ss_pred eeCCceeEEEEeCCeEEEEEC-CEEEEEEcCCcEEEEEE
Q 020784 173 SFRSEVRSVKLRRDRIIVVLE-QKIFVYNFADLKLLHQI 210 (321)
Q Consensus 173 ~~~~~v~~v~~~~~~~~~~~~-~~I~iwd~~~~~~~~~l 210 (321)
.+.++-..++-..+.++...+ ..+++-|..+.....++
T Consensus 128 ~y~GeGWgLt~d~~~LimsdGsatL~frdP~tfa~~~~v 166 (262)
T COG3823 128 SYEGEGWGLTSDDKNLIMSDGSATLQFRDPKTFAELDTV 166 (262)
T ss_pred ccCCcceeeecCCcceEeeCCceEEEecCHHHhhhcceE
Confidence 888887788777666544433 36766676655444444
No 368
>PF14761 HPS3_N: Hermansky-Pudlak syndrome 3
Probab=95.08 E-value=1.3 Score=37.57 Aligned_cols=113 Identities=19% Similarity=0.160 Sum_probs=64.6
Q ss_pred CceeEEEEeC-CeEEEEE-CCEEEEEEcC--CcEEEEEEeccCCCCceEEEeeCCCceEEEeecCC--CC---cEEE---
Q 020784 176 SEVRSVKLRR-DRIIVVL-EQKIFVYNFA--DLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQ--KG---QVRV--- 243 (321)
Q Consensus 176 ~~v~~v~~~~-~~~~~~~-~~~I~iwd~~--~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~--dg---~V~i--- 243 (321)
.++..++..+ +.+++++ +..|.+|++. ..+.+.+|.+- +.+..+.++.. |.++++--.. .. .+|+
T Consensus 18 ~EP~~~c~~g~d~Lfva~~g~~Vev~~l~~~~~~~~~~F~Tv-~~V~~l~y~~~--GDYlvTlE~k~~~~~~~fvR~Y~N 94 (215)
T PF14761_consen 18 QEPTAVCCGGPDALFVAASGCKVEVYDLEQEECPLLCTFSTV-GRVLQLVYSEA--GDYLVTLEEKNKRSPVDFVRAYFN 94 (215)
T ss_pred cCcceeeccCCceEEEEcCCCEEEEEEcccCCCceeEEEcch-hheeEEEeccc--cceEEEEEeecCCccceEEEEEEE
Confidence 3566777766 7777755 4599999987 45666777664 23334444444 4566642211 11 4555
Q ss_pred EeeCC---cceE-Eeecc---------------------ccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcE
Q 020784 244 EHYAS---KRTK-FIMAH---------------------DSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTL 293 (321)
Q Consensus 244 ~d~~~---~~~~-~l~~H---------------------~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~ 293 (321)
|+... .++. .+-|| ...+.|++-.|-..-|+.|+ +++ +.||.+..+..
T Consensus 95 Wr~~~~~~~~v~vRiaG~~v~~~~~~~~~~qleiiElPl~~~p~ciaCC~~tG~LlVg~-~~~-l~lf~l~~~~~ 167 (215)
T PF14761_consen 95 WRSQKEENSPVRVRIAGHRVTPSFNESSKDQLEIIELPLSEPPLCIACCPVTGNLLVGC-GNK-LVLFTLKYQTI 167 (215)
T ss_pred hhhhcccCCcEEEEEcccccccCCCCccccceEEEEecCCCCCCEEEecCCCCCEEEEc-CCE-EEEEEEEEEEE
Confidence 55431 1111 22232 34678888887633345566 556 88998876543
No 369
>PF06977 SdiA-regulated: SdiA-regulated; InterPro: IPR009722 This entry represents a conserved region approximately 100 residues long within a number of hypothetical bacterial proteins that may be regulated by SdiA, a member of the LuxR family of transcriptional regulators []. Some proteins contain the IPR001258 from INTERPRO repeat.; PDB: 3QQZ_A.
Probab=95.06 E-value=2.2 Score=37.38 Aligned_cols=188 Identities=14% Similarity=0.112 Sum_probs=91.3
Q ss_pred CeEEEEEcCCCCEEEEEcC-Cc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC
Q 020784 87 TLLHISFNQDHGCFAAGTD-HG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH 164 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~-~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~ 164 (321)
.+..++|+||...|++-.+ .+ +..++. .++.+....+...+....+++..++ .++++.. .++.+.+.++.
T Consensus 23 e~SGLTy~pd~~tLfaV~d~~~~i~els~-~G~vlr~i~l~g~~D~EgI~y~g~~-~~vl~~E------r~~~L~~~~~~ 94 (248)
T PF06977_consen 23 ELSGLTYNPDTGTLFAVQDEPGEIYELSL-DGKVLRRIPLDGFGDYEGITYLGNG-RYVLSEE------RDQRLYIFTID 94 (248)
T ss_dssp -EEEEEEETTTTEEEEEETTTTEEEEEET-T--EEEEEE-SS-SSEEEEEE-STT-EEEEEET------TTTEEEEEEE-
T ss_pred CccccEEcCCCCeEEEEECCCCEEEEEcC-CCCEEEEEeCCCCCCceeEEEECCC-EEEEEEc------CCCcEEEEEEe
Confidence 5999999998665555444 55 334443 3555555555223567777776444 4555553 35888888873
Q ss_pred CC--c----EEEEEe--eC----CceeEEEEeC--CeEEEEEC-CEEEEEEcCC---cEEEEEEe--c------cCCCCc
Q 020784 165 QS--R----CIGELS--FR----SEVRSVKLRR--DRIIVVLE-QKIFVYNFAD---LKLLHQIE--T------IANPKG 218 (321)
Q Consensus 165 ~~--~----~~~~~~--~~----~~v~~v~~~~--~~~~~~~~-~~I~iwd~~~---~~~~~~l~--~------~~~~~~ 218 (321)
.. . ....+. .. ..+-.++|++ ++++++.+ +-.++|.+.. ...+.... . ......
T Consensus 95 ~~~~~~~~~~~~~~~l~~~~~~N~G~EGla~D~~~~~L~v~kE~~P~~l~~~~~~~~~~~~~~~~~~~~~~~~~~~~d~S 174 (248)
T PF06977_consen 95 DDTTSLDRADVQKISLGFPNKGNKGFEGLAYDPKTNRLFVAKERKPKRLYEVNGFPGGFDLFVSDDQDLDDDKLFVRDLS 174 (248)
T ss_dssp ---TT--EEEEEEEE---S---SS--EEEEEETTTTEEEEEEESSSEEEEEEESTT-SS--EEEE-HHHH-HT--SS---
T ss_pred ccccccchhhceEEecccccCCCcceEEEEEcCCCCEEEEEeCCCChhhEEEccccCccceeeccccccccccceecccc
Confidence 21 1 112222 22 2367788876 56777755 3455665532 11111111 1 111223
Q ss_pred eEEEeeCCCceEEEeecCCCCcEEEEeeCCcceE--Eeec--c-----ccceeEEEECCCCCEEEEEeCCCcEEEEE
Q 020784 219 LCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTK--FIMA--H-----DSRIACFALTQDGQLLATSSTKGTLVRIF 286 (321)
Q Consensus 219 ~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~--~l~~--H-----~~~V~~vafspdg~~las~S~Dgt~IrIW 286 (321)
.+.+.+.. +.+++. ...+..|.+.|.+.+.+. .|.. | -...-.|+|.++|.+.+ .|+.+- ..+|
T Consensus 175 ~l~~~p~t-~~lliL-S~es~~l~~~d~~G~~~~~~~L~~g~~gl~~~~~QpEGIa~d~~G~LYI-vsEpNl-fy~f 247 (248)
T PF06977_consen 175 GLSYDPRT-GHLLIL-SDESRLLLELDRQGRVVSSLSLDRGFHGLSKDIPQPEGIAFDPDGNLYI-VSEPNL-FYRF 247 (248)
T ss_dssp EEEEETTT-TEEEEE-ETTTTEEEEE-TT--EEEEEE-STTGGG-SS---SEEEEEE-TT--EEE-EETTTE-EEEE
T ss_pred ceEEcCCC-CeEEEE-ECCCCeEEEECCCCCEEEEEEeCCcccCcccccCCccEEEECCCCCEEE-EcCCce-EEEe
Confidence 45555543 345554 466667777886555443 3332 1 13578899999998766 556665 5554
No 370
>PF08596 Lgl_C: Lethal giant larvae(Lgl) like, C-terminal; InterPro: IPR013905 The Lethal giant larvae (Lgl) tumour suppressor protein is conserved from yeast to mammals. The Lgl protein functions in cell polarity, at least in part, by regulating SNARE-mediated membrane delivery events at the cell surface []. The N-terminal half of Lgl members contains WD40 repeats (see IPR001680 from INTERPRO), while the C-terminal half appears specific to the protein []. ; PDB: 2OAJ_A.
Probab=95.02 E-value=3.2 Score=39.06 Aligned_cols=217 Identities=13% Similarity=0.193 Sum_probs=112.0
Q ss_pred CeEEEEEcCCCCEEEEEcCCc-EEEEEecCCcee-------------------------EE------------------e
Q 020784 87 TLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREI-------------------------FR------------------R 122 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~-------------------------~~------------------~ 122 (321)
.|+.++|.++..-||+|...| |.||.+...+.- .. .
T Consensus 3 ~v~~vs~a~~t~Elav~~~~GeVv~~k~~~n~~~~~~~~~~~~~~~~~~~~~~~~~~~l~di~~r~~~~~~~gf~P~~l~ 82 (395)
T PF08596_consen 3 SVTHVSFAPETLELAVGLESGEVVLFKFGKNQNYGNREQPPDLDYNFRRFSLNNSPGKLTDISDRAPPSLKEGFLPLTLL 82 (395)
T ss_dssp -EEEEEEETTTTEEEEEETTS-EEEEEEEE------------------S--GGGSS-SEEE-GGG--TT-SEEEEEEEEE
T ss_pred eEEEEEecCCCceEEEEccCCcEEEEEcccCCCCCccCCCcccCcccccccccCCCcceEEehhhCCcccccccCchhhe
Confidence 589999999988899998866 778865321110 00 0
Q ss_pred eeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCC---------ceeEEEEe-----CC--
Q 020784 123 DFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRS---------EVRSVKLR-----RD-- 186 (321)
Q Consensus 123 ~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~---------~v~~v~~~-----~~-- 186 (321)
+. ..+.|..++.+ +-..+|++. .+|.+.|.|++....+..-.... .|++++|. .+
T Consensus 83 ~~-~~g~vtal~~S-~iGFvaigy-------~~G~l~viD~RGPavI~~~~i~~~~~~~~~~~~vt~ieF~vm~~~~D~y 153 (395)
T PF08596_consen 83 DA-KQGPVTALKNS-DIGFVAIGY-------ESGSLVVIDLRGPAVIYNENIRESFLSKSSSSYVTSIEFSVMTLGGDGY 153 (395)
T ss_dssp ----S-SEEEEEE--BTSEEEEEE-------TTSEEEEEETTTTEEEEEEEGGG--T-SS----EEEEEEEEEE-TTSSS
T ss_pred ec-cCCcEeEEecC-CCcEEEEEe-------cCCcEEEEECCCCeEEeeccccccccccccccCeeEEEEEEEecCCCcc
Confidence 00 23455555554 333445544 67999999998888776643322 47777774 22
Q ss_pred ---eEEEEEC-CEEEEEEcC--C-cEEEEEEe----ccCCCC-ceEEEeeCC--------------------CceEEEee
Q 020784 187 ---RIIVVLE-QKIFVYNFA--D-LKLLHQIE----TIANPK-GLCAVSQGV--------------------GSLVLVCP 234 (321)
Q Consensus 187 ---~~~~~~~-~~I~iwd~~--~-~~~~~~l~----~~~~~~-~~~~~s~~~--------------------d~~~la~s 234 (321)
.++++++ +.+.+|.+. . +.....+. .+..++ .++.+..+. .+.+++
T Consensus 154 SSi~L~vGTn~G~v~~fkIlp~~~g~f~v~~~~~~~~~~~~i~~I~~i~~~~G~~a~At~~~~~~l~~g~~i~g~vVv-- 231 (395)
T PF08596_consen 154 SSICLLVGTNSGNVLTFKILPSSNGRFSVQFAGATTNHDSPILSIIPINADTGESALATISAMQGLSKGISIPGYVVV-- 231 (395)
T ss_dssp EEEEEEEEETTSEEEEEEEEE-GGG-EEEEEEEEE--SS----EEEEEETTT--B-B-BHHHHHGGGGT----EEEEE--
T ss_pred cceEEEEEeCCCCEEEEEEecCCCCceEEEEeeccccCCCceEEEEEEECCCCCcccCchhHhhccccCCCcCcEEEE--
Confidence 2455555 688888773 1 21111111 122222 233342221 122333
Q ss_pred cCCCCcEEEEeeCCcc-eE-EeeccccceeEEEE-----CCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCc-----
Q 020784 235 GLQKGQVRVEHYASKR-TK-FIMAHDSRIACFAL-----TQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSI----- 302 (321)
Q Consensus 235 Gs~dg~V~i~d~~~~~-~~-~l~~H~~~V~~vaf-----spdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~----- 302 (321)
..+..+++......+ .+ .+ ...-.+..+++ ...+..|++--.+|. |+++.+...+.+.+++....
T Consensus 232 -vSe~~irv~~~~~~k~~~K~~-~~~~~~~~~~vv~~~~~~~~~~Lv~l~~~G~-i~i~SLP~Lkei~~~~l~~~~d~~~ 308 (395)
T PF08596_consen 232 -VSESDIRVFKPPKSKGAHKSF-DDPFLCSSASVVPTISRNGGYCLVCLFNNGS-IRIYSLPSLKEIKSVSLPPPLDSRR 308 (395)
T ss_dssp -E-SSEEEEE-TT---EEEEE--SS-EEEEEEEEEEEE-EEEEEEEEEEETTSE-EEEEETTT--EEEEEE-SS---HHH
T ss_pred -EcccceEEEeCCCCcccceee-ccccccceEEEEeecccCCceEEEEEECCCc-EEEEECCCchHhhcccCCCcccccc
Confidence 224467776554332 22 33 22223444455 235778888889999 99999999999988765321
Q ss_pred ceeEEEeecCceEEE
Q 020784 303 SAQSGLWLSSAWLRV 317 (321)
Q Consensus 303 ~~~~~~s~d~~~la~ 317 (321)
....+++.+|..+..
T Consensus 309 ~~~ssis~~Gdi~~~ 323 (395)
T PF08596_consen 309 LSSSSISRNGDIFYW 323 (395)
T ss_dssp HTT-EE-TTS-EEEE
T ss_pred ccccEECCCCCEEEE
Confidence 123477788876654
No 371
>PF09826 Beta_propel: Beta propeller domain; InterPro: IPR019198 This entry consists of predicted secreted proteins containing a C-terminal beta-propeller domain distantly related to WD-40 repeats.
Probab=95.02 E-value=3.8 Score=39.99 Aligned_cols=101 Identities=15% Similarity=0.200 Sum_probs=63.9
Q ss_pred CCCCEEEEEcCCcEEEEEec---CCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCC------------------CC
Q 020784 95 QDHGCFAAGTDHGFRIYNCD---PFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDP------------------QY 153 (321)
Q Consensus 95 ~dg~~lasg~~~gv~vw~~~---~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~------------------~~ 153 (321)
-||++|....++.+.|++.. ..+......+ .+. ..++.-+++.+++.+..... ..
T Consensus 20 TDG~yIY~v~~~~l~Iida~p~~~~~~~s~I~~--~~~--~~eLyl~gdrLvVi~~~~~~~~~~~~~~~~~~~~~~~~~~ 95 (521)
T PF09826_consen 20 TDGEYIYVVSGGRLYIIDAYPAEEMKVVSRIDL--DGS--PQELYLDGDRLVVIGSSYEYYPREPDIDSESGDTPYYYYK 95 (521)
T ss_pred ECCCEEEEEeCCEEEEEECCCchhceEEEEEec--CCC--hhheEEcCCEEEEEEeccccccccccccccccccccccCC
Confidence 38999999998889999983 4445445554 333 22333355555555532210 00
Q ss_pred CCCcEEEEeCCCC---cEEEEEeeCCceeEEEEeCCeEEEEECCEEEEE
Q 020784 154 PLNKVMIWDDHQS---RCIGELSFRSEVRSVKLRRDRIIVVLEQKIFVY 199 (321)
Q Consensus 154 ~d~~v~iWD~~~~---~~~~~~~~~~~v~~v~~~~~~~~~~~~~~I~iw 199 (321)
.--.+.++|+... +.+.++...+...+.....+.+.+.+...+.+|
T Consensus 96 ~~t~i~vYDIsD~~~P~~~~~~~~~G~yvsSR~ig~~vy~Vt~~~~~~~ 144 (521)
T PF09826_consen 96 SSTKITVYDISDPSNPKLLREIEIEGSYVSSRKIGDYVYLVTNSYPNYY 144 (521)
T ss_pred ceeEEEEEECCCCCCceEEEEEEeeeEEEeEEEECCEEEEEEecCCccc
Confidence 1235888987644 467777777777777777788888887766666
No 372
>KOG3617 consensus WD40 and TPR repeat-containing protein [General function prediction only]
Probab=94.99 E-value=0.051 Score=54.17 Aligned_cols=113 Identities=13% Similarity=0.068 Sum_probs=80.3
Q ss_pred CceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCeEEEEEC---CEEEEEEcCCc
Q 020784 128 GGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDRIIVVLE---QKIFVYNFADL 204 (321)
Q Consensus 128 ~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~---~~I~iwd~~~~ 204 (321)
+.-.+..|+|.-.++++++=+.. ..|.|.|+- ++|+.-.....+..++++|||+..++++.+ +.+.+|...+.
T Consensus 16 avsti~SWHPsePlfAVA~fS~e---r~GSVtIfa-dtGEPqr~Vt~P~hatSLCWHpe~~vLa~gwe~g~~~v~~~~~~ 91 (1416)
T KOG3617|consen 16 AVSTISSWHPSEPLFAVASFSPE---RGGSVTIFA-DTGEPQRDVTYPVHATSLCWHPEEFVLAQGWEMGVSDVQKTNTT 91 (1416)
T ss_pred ccccccccCCCCceeEEEEecCC---CCceEEEEe-cCCCCCcccccceehhhhccChHHHHHhhccccceeEEEecCCc
Confidence 33445677888788877763221 347788884 456655566666778899999988766643 68999998876
Q ss_pred EEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeC
Q 020784 205 KLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYA 247 (321)
Q Consensus 205 ~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~ 247 (321)
+.-....+|..++..+.+++++ ..+. ++..-|.|.+|.+.
T Consensus 92 e~htv~~th~a~i~~l~wS~~G--~~l~-t~d~~g~v~lwr~d 131 (1416)
T KOG3617|consen 92 ETHTVVETHPAPIQGLDWSHDG--TVLM-TLDNPGSVHLWRYD 131 (1416)
T ss_pred eeeeeccCCCCCceeEEecCCC--CeEE-EcCCCceeEEEEee
Confidence 6654556677777777777765 5566 58999999998764
No 373
>KOG1897 consensus Damage-specific DNA binding complex, subunit DDB1 [Replication, recombination and repair]
Probab=94.79 E-value=3 Score=42.84 Aligned_cols=197 Identities=12% Similarity=0.144 Sum_probs=118.4
Q ss_pred CeEEEEEcCCCCEEEEEcCC---------------cEEEEEecCCceeEEeeeecCC---ceEEEEEecCCCeEEEEeCC
Q 020784 87 TLLHISFNQDHGCFAAGTDH---------------GFRIYNCDPFREIFRRDFERGG---GIGVVEMLFRCNILALVGGG 148 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~~---------------gv~vw~~~~~~~~~~~~~~~~~---~v~~v~~~~~~~~~~~~sg~ 148 (321)
..+.+++.+...++++.+++ -++++|-++.+.....++.... .+..+.+..+.+...+++.+
T Consensus 716 ~prrI~~q~~sl~~~v~s~r~e~~~~~~~ee~~~s~l~vlD~nTf~vl~~hef~~~E~~~Si~s~~~~~d~~t~~vVGT~ 795 (1096)
T KOG1897|consen 716 SPRRICYQESSLTFGVLSNRIESSAEYYGEEYEVSFLRVLDQNTFEVLSSHEFERNETALSIISCKFTDDPNTYYVVGTG 795 (1096)
T ss_pred ChhheEecccceEEEEEecccccchhhcCCcceEEEEEEecCCceeEEeeccccccceeeeeeeeeecCCCceEEEEEEE
Confidence 45566666644444443321 2568888888776655552111 22233344454554444422
Q ss_pred CCC----CCCCCcEEEEeCCCC---cEEEEEeeCCceeEEEEeCCeEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEE
Q 020784 149 PDP----QYPLNKVMIWDDHQS---RCIGELSFRSEVRSVKLRRDRIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCA 221 (321)
Q Consensus 149 ~~~----~~~d~~v~iWD~~~~---~~~~~~~~~~~v~~v~~~~~~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~ 221 (321)
... .-..|.|.|+.+..+ +.+.+.+..+.|.++..-+.+++++-...|++|++.+.+.++.=..+..+..+..
T Consensus 796 ~v~Pde~ep~~GRIivfe~~e~~~L~~v~e~~v~Gav~aL~~fngkllA~In~~vrLye~t~~~eLr~e~~~~~~~~aL~ 875 (1096)
T KOG1897|consen 796 LVYPDENEPVNGRIIVFEFEELNSLELVAETVVKGAVYALVEFNGKLLAGINQSVRLYEWTTERELRIECNISNPIIALD 875 (1096)
T ss_pred eeccCCCCcccceEEEEEEecCCceeeeeeeeeccceeehhhhCCeEEEecCcEEEEEEccccceehhhhcccCCeEEEE
Confidence 210 012366788876653 2445566677888888777788888899999999998877666555666666777
Q ss_pred EeeCCCceEEEeecCCCCcEEE--EeeCCcceEE--eeccccceeEEEECCCCCEEEEEeCCCcEEEEEEc
Q 020784 222 VSQGVGSLVLVCPGLQKGQVRV--EHYASKRTKF--IMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 222 ~s~~~d~~~la~sGs~dg~V~i--~d~~~~~~~~--l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~ 288 (321)
+...+ ..+++ |+--+.|.+ ++...+.... -..|....+++.+-.+..+|. +-.+|. +.+-..
T Consensus 876 l~v~g--deI~V-gDlm~Sitll~y~~~eg~f~evArD~~p~Wmtaveil~~d~ylg-ae~~gN-lf~v~~ 941 (1096)
T KOG1897|consen 876 LQVKG--DEIAV-GDLMRSITLLQYKGDEGNFEEVARDYNPNWMTAVEILDDDTYLG-AENSGN-LFTVRK 941 (1096)
T ss_pred EEecC--cEEEE-eeccceEEEEEEeccCCceEEeehhhCccceeeEEEecCceEEe-eccccc-EEEEEe
Confidence 77765 44553 788888887 4433333333 234777888888876555543 444666 555443
No 374
>PF05096 Glu_cyclase_2: Glutamine cyclotransferase; InterPro: IPR007788 This family of enzymes 2.3.2.5 from EC catalyse the cyclization of free L-glutamine and N-terminal glutaminyl residues in proteins to pyroglutamate (5-oxoproline) and pyroglutamyl residues respectively []. This family includes plant and bacterial enzymes and seems unrelated to the mammalian enzymes.; PDB: 3NOK_B 2FAW_A 2IWA_A 3NOM_A 3NOL_A 3MBR_X.
Probab=94.72 E-value=2.8 Score=36.91 Aligned_cols=136 Identities=10% Similarity=0.106 Sum_probs=87.3
Q ss_pred CCcEEEEeCCCCcEEEEEeeCCceeE--EEEeCCeEEEEE--CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceE
Q 020784 155 LNKVMIWDDHQSRCIGELSFRSEVRS--VKLRRDRIIVVL--EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLV 230 (321)
Q Consensus 155 d~~v~iWD~~~~~~~~~~~~~~~v~~--v~~~~~~~~~~~--~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~ 230 (321)
...|+.+|+.+++......++....+ +....+.+...+ ++...+||..+.+.+.++...... ..++.+++ .+
T Consensus 67 ~S~l~~~d~~tg~~~~~~~l~~~~FgEGit~~~d~l~qLTWk~~~~f~yd~~tl~~~~~~~y~~EG---WGLt~dg~-~L 142 (264)
T PF05096_consen 67 QSSLRKVDLETGKVLQSVPLPPRYFGEGITILGDKLYQLTWKEGTGFVYDPNTLKKIGTFPYPGEG---WGLTSDGK-RL 142 (264)
T ss_dssp EEEEEEEETTTSSEEEEEE-TTT--EEEEEEETTEEEEEESSSSEEEEEETTTTEEEEEEE-SSS-----EEEECSS-CE
T ss_pred cEEEEEEECCCCcEEEEEECCccccceeEEEECCEEEEEEecCCeEEEEccccceEEEEEecCCcc---eEEEcCCC-EE
Confidence 45799999999999888888776554 777888888776 579999999999999988654222 23334443 34
Q ss_pred EEeecCCCCcEEEEeeCCcc-eEEee--ccc---cceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEe
Q 020784 231 LVCPGLQKGQVRVEHYASKR-TKFIM--AHD---SRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEEC 298 (321)
Q Consensus 231 la~sGs~dg~V~i~d~~~~~-~~~l~--~H~---~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~ 298 (321)
+.. +....+..+|-.+-. ...+. ... ..++.+.|- +|...|=.=.... |-.-|..+|+++..++
T Consensus 143 i~S--DGS~~L~~~dP~~f~~~~~i~V~~~g~pv~~LNELE~i-~G~IyANVW~td~-I~~Idp~tG~V~~~iD 212 (264)
T PF05096_consen 143 IMS--DGSSRLYFLDPETFKEVRTIQVTDNGRPVSNLNELEYI-NGKIYANVWQTDR-IVRIDPETGKVVGWID 212 (264)
T ss_dssp EEE---SSSEEEEE-TTT-SEEEEEE-EETTEE---EEEEEEE-TTEEEEEETTSSE-EEEEETTT-BEEEEEE
T ss_pred EEE--CCccceEEECCcccceEEEEEEEECCEECCCcEeEEEE-cCEEEEEeCCCCe-EEEEeCCCCeEEEEEE
Confidence 442 223467777754322 22222 122 346667776 7888887766666 8889999999998774
No 375
>PF14583 Pectate_lyase22: Oligogalacturonate lyase; PDB: 3C5M_C 3PE7_A.
Probab=94.62 E-value=1.9 Score=39.94 Aligned_cols=177 Identities=11% Similarity=0.015 Sum_probs=86.3
Q ss_pred EEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCC-ceeEEEEeCC--eEEEEE-CCEEEEEEcCCcEEEEE
Q 020784 134 EMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRS-EVRSVKLRRD--RIIVVL-EQKIFVYNFADLKLLHQ 209 (321)
Q Consensus 134 ~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~-~v~~v~~~~~--~~~~~~-~~~I~iwd~~~~~~~~~ 209 (321)
++..+++.+++.+..+ ....+.+.|+.+++..+--.... ......++++ .++-.. +..++-.|+.+++....
T Consensus 42 ~ft~dG~kllF~s~~d----g~~nly~lDL~t~~i~QLTdg~g~~~~g~~~s~~~~~~~Yv~~~~~l~~vdL~T~e~~~v 117 (386)
T PF14583_consen 42 CFTDDGRKLLFASDFD----GNRNLYLLDLATGEITQLTDGPGDNTFGGFLSPDDRALYYVKNGRSLRRVDLDTLEERVV 117 (386)
T ss_dssp -B-TTS-EEEEEE-TT----SS-EEEEEETTT-EEEE---SS-B-TTT-EE-TTSSEEEEEETTTEEEEEETTT--EEEE
T ss_pred CcCCCCCEEEEEeccC----CCcceEEEEcccCEEEECccCCCCCccceEEecCCCeEEEEECCCeEEEEECCcCcEEEE
Confidence 3455788888877532 35678888999998776544432 2223333333 333333 45888889988776555
Q ss_pred EeccCCCCceEEEeeCCCceEEEeecCC-----------------------CCcEEEEeeCCcceEEeeccccceeEEEE
Q 020784 210 IETIANPKGLCAVSQGVGSLVLVCPGLQ-----------------------KGQVRVEHYASKRTKFIMAHDSRIACFAL 266 (321)
Q Consensus 210 l~~~~~~~~~~~~s~~~d~~~la~sGs~-----------------------dg~V~i~d~~~~~~~~l~~H~~~V~~vaf 266 (321)
+.......+...+..+.|+..++ |.. ...|...|+.++..+++-.-...+.-+-|
T Consensus 118 y~~p~~~~g~gt~v~n~d~t~~~--g~e~~~~d~~~l~~~~~f~e~~~a~p~~~i~~idl~tG~~~~v~~~~~wlgH~~f 195 (386)
T PF14583_consen 118 YEVPDDWKGYGTWVANSDCTKLV--GIEISREDWKPLTKWKGFREFYEARPHCRIFTIDLKTGERKVVFEDTDWLGHVQF 195 (386)
T ss_dssp EE--TTEEEEEEEEE-TTSSEEE--EEEEEGGG-----SHHHHHHHHHC---EEEEEEETTT--EEEEEEESS-EEEEEE
T ss_pred EECCcccccccceeeCCCccEEE--EEEEeehhccCccccHHHHHHHhhCCCceEEEEECCCCceeEEEecCccccCccc
Confidence 55555555445555555666665 211 11222345566666665555666788999
Q ss_pred CCCCCEEEEEeCCC-----cEEEEEEcCC-CcEEEEEeCC--CcceeE-EEeecCceEEE
Q 020784 267 TQDGQLLATSSTKG-----TLVRIFNTLD-GTLLQEECCP--SISAQS-GLWLSSAWLRV 317 (321)
Q Consensus 267 spdg~~las~S~Dg-----t~IrIWd~~t-g~~i~~~~~g--~~~~~~-~~s~d~~~la~ 317 (321)
||....+++-+..| . -|||-+.+ |...+.++.- ...+.. -+++||..|..
T Consensus 196 sP~dp~li~fCHEGpw~~Vd-~RiW~i~~dg~~~~~v~~~~~~e~~gHEfw~~DG~~i~y 254 (386)
T PF14583_consen 196 SPTDPTLIMFCHEGPWDLVD-QRIWTINTDGSNVKKVHRRMEGESVGHEFWVPDGSTIWY 254 (386)
T ss_dssp ETTEEEEEEEEE-S-TTTSS--SEEEEETTS---EESS---TTEEEEEEEE-TTSS-EEE
T ss_pred CCCCCCEEEEeccCCcceec-eEEEEEEcCCCcceeeecCCCCcccccccccCCCCEEEE
Confidence 98876666654433 2 37897754 4444433222 122222 56788876654
No 376
>cd00216 PQQ_DH Dehydrogenases with pyrrolo-quinoline quinone (PQQ) as cofactor, like ethanol, methanol, and membrane bound glucose dehydrogenases. The alignment model contains an 8-bladed beta-propeller.
Probab=94.49 E-value=5 Score=38.87 Aligned_cols=48 Identities=21% Similarity=0.308 Sum_probs=32.6
Q ss_pred CCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcceeE--EEeecC-ceEEEe
Q 020784 270 GQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQS--GLWLSS-AWLRVL 318 (321)
Q Consensus 270 g~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~--~~s~d~-~~la~~ 318 (321)
+.+|..++.||. |+-+|..+|+.+-+++.+...... .+..++ .|++++
T Consensus 406 g~~v~~g~~dG~-l~ald~~tG~~lW~~~~~~~~~a~P~~~~~~g~~yv~~~ 456 (488)
T cd00216 406 GNLVFAGAADGY-FRAFDATTGKELWKFRTPSGIQATPMTYEVNGKQYVGVM 456 (488)
T ss_pred CCeEEEECCCCe-EEEEECCCCceeeEEECCCCceEcCEEEEeCCEEEEEEE
Confidence 456677888999 999999999999888765443222 334455 455543
No 377
>PF05694 SBP56: 56kDa selenium binding protein (SBP56); InterPro: IPR008826 This family consists of several eukaryotic selenium binding proteins as well as three sequences from archaea. The exact function of this protein is unknown although it is thought that SBP56 participates in late stages of intra-Golgi protein transport []. The Lotus japonicus homologue of SBP56, LjSBP is thought to have more than one physiological role and can be implicated in controlling the oxidation/reduction status of target proteins in vesicular Golgi transport [].; GO: 0008430 selenium binding; PDB: 2ECE_A.
Probab=94.39 E-value=4.6 Score=38.08 Aligned_cols=153 Identities=16% Similarity=0.124 Sum_probs=73.8
Q ss_pred cCCCCEEEEEc--C-----CcEEEEEecCCceeEEeeeecCCc---eEEEEEecCCCeEEEEeCCCC-------------
Q 020784 94 NQDHGCFAAGT--D-----HGFRIYNCDPFREIFRRDFERGGG---IGVVEMLFRCNILALVGGGPD------------- 150 (321)
Q Consensus 94 s~dg~~lasg~--~-----~gv~vw~~~~~~~~~~~~~~~~~~---v~~v~~~~~~~~~~~~sg~~~------------- 150 (321)
-|+|+.++++. . .++.+.|-++++....++.. .+. -...-+.+.-|.+++...+.-
T Consensus 138 lp~G~imIS~lGd~~G~g~Ggf~llD~~tf~v~g~We~~-~~~~~~gYDfw~qpr~nvMiSSeWg~P~~~~~Gf~~~d~~ 216 (461)
T PF05694_consen 138 LPDGRIMISALGDADGNGPGGFVLLDGETFEVKGRWEKD-RGPQPFGYDFWYQPRHNVMISSEWGAPSMFEKGFNPEDLE 216 (461)
T ss_dssp -SS--EEEEEEEETTS-S--EEEEE-TTT--EEEE--SB--TT------EEEETTTTEEEE-B---HHHHTT---TTTHH
T ss_pred cCCccEEEEeccCCCCCCCCcEEEEcCccccccceeccC-CCCCCCCCCeEEcCCCCEEEEeccCChhhcccCCChhHhh
Confidence 47888777643 1 34789998888877666641 111 123344566677776654430
Q ss_pred -CCCCCCcEEEEeCCCCcEEEEEeeCC---ceeEEEEeCC------eEEEEECCEE-EEEEcCCc--EEEEEEeccC---
Q 020784 151 -PQYPLNKVMIWDDHQSRCIGELSFRS---EVRSVKLRRD------RIIVVLEQKI-FVYNFADL--KLLHQIETIA--- 214 (321)
Q Consensus 151 -~~~~d~~v~iWD~~~~~~~~~~~~~~---~v~~v~~~~~------~~~~~~~~~I-~iwd~~~~--~~~~~l~~~~--- 214 (321)
.. .-+++.+||+.+.+.++++.+.. .+..|.|..+ +..++...+| ++|...++ +..+.++-..
T Consensus 217 ~~~-yG~~l~vWD~~~r~~~Q~idLg~~g~~pLEvRflH~P~~~~gFvg~aLss~i~~~~k~~~g~W~a~kVi~ip~~~v 295 (461)
T PF05694_consen 217 AGK-YGHSLHVWDWSTRKLLQTIDLGEEGQMPLEVRFLHDPDANYGFVGCALSSSIWRFYKDDDGEWAAEKVIDIPAKKV 295 (461)
T ss_dssp HH--S--EEEEEETTTTEEEEEEES-TTEEEEEEEEE-SSTT--EEEEEEE--EEEEEEEE-ETTEEEEEEEEEE--EE-
T ss_pred ccc-ccCeEEEEECCCCcEeeEEecCCCCCceEEEEecCCCCccceEEEEeccceEEEEEEcCCCCeeeeEEEECCCccc
Confidence 01 13789999999999999998863 4667777543 2333344444 44443332 2222222111
Q ss_pred --C------------CCceEEEeeCCCceEEEeecCCCCcEEEEeeCC
Q 020784 215 --N------------PKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYAS 248 (321)
Q Consensus 215 --~------------~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~ 248 (321)
. +-.+.+|.-.-|..+|-++.-..|.|+-+|+..
T Consensus 296 ~~~~lp~ml~~~~~~P~LitDI~iSlDDrfLYvs~W~~GdvrqYDISD 343 (461)
T PF05694_consen 296 EGWILPEMLKPFGAVPPLITDILISLDDRFLYVSNWLHGDVRQYDISD 343 (461)
T ss_dssp -SS---GGGGGG-EE------EEE-TTS-EEEEEETTTTEEEEEE-SS
T ss_pred CcccccccccccccCCCceEeEEEccCCCEEEEEcccCCcEEEEecCC
Confidence 0 123455555556677777889999999999875
No 378
>PHA02713 hypothetical protein; Provisional
Probab=94.34 E-value=5.5 Score=39.33 Aligned_cols=60 Identities=10% Similarity=-0.021 Sum_probs=35.1
Q ss_pred eEEEeecCCCC------cEEEEeeCC-cc---eEEeeccccceeEEEECCCCCEEEEEeCCC--cEEEEEEcCCCc
Q 020784 229 LVLVCPGLQKG------QVRVEHYAS-KR---TKFIMAHDSRIACFALTQDGQLLATSSTKG--TLVRIFNTLDGT 292 (321)
Q Consensus 229 ~~la~sGs~dg------~V~i~d~~~-~~---~~~l~~H~~~V~~vafspdg~~las~S~Dg--t~IrIWd~~tg~ 292 (321)
.+.++ |+.++ .|..+|..+ .. +..+.........+++ +|++.+.|+.|| + +-.||..+.+
T Consensus 465 ~IYv~-GG~~~~~~~~~~ve~Ydp~~~~~W~~~~~m~~~r~~~~~~~~--~~~iyv~Gg~~~~~~-~e~yd~~~~~ 536 (557)
T PHA02713 465 DIYVV-CDIKDEKNVKTCIFRYNTNTYNGWELITTTESRLSALHTILH--DNTIMMLHCYESYML-QDTFNVYTYE 536 (557)
T ss_pred EEEEE-eCCCCCCccceeEEEecCCCCCCeeEccccCcccccceeEEE--CCEEEEEeeecceee-hhhcCccccc
Confidence 56665 54332 345577665 33 1233333334444444 688999999998 6 7777777654
No 379
>TIGR03075 PQQ_enz_alc_DH PQQ-dependent dehydrogenase, methanol/ethanol family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Genes in this family often are found adjacent to the PQQ biosynthesis genes themselves. An unusual, strained disulfide bond between adjacent Cys residues contributes to PQQ-binding, as does a Trp residue that is part of a PQQ enzyme repeat (see pfam01011). Characterized members include the dehydrogenase subunit of a membrane-anchored, three subunit alcohol (ethanol) dehydrogenase of Gluconobacter suboxydans, a homodimeric ethanol dehydrogenase in Pseudomonas aeruginosa, and the large subunit of an alpha2/beta2 heterotetrameric methanol dehydrogenase in Methylobacterium extorquens.
Probab=94.22 E-value=6 Score=38.75 Aligned_cols=192 Identities=13% Similarity=0.170 Sum_probs=101.1
Q ss_pred CCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEE---EEE-----ecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCc
Q 020784 96 DHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGV---VEM-----LFRCNILALVGGGPDPQYPLNKVMIWDDHQSR 167 (321)
Q Consensus 96 dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~---v~~-----~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~ 167 (321)
+|..+++..++.|.-.|..+++.+.+........+.. ... ......+.+.+ .++.|.-.|.++|+
T Consensus 69 ~g~vyv~s~~g~v~AlDa~TGk~lW~~~~~~~~~~~~~~~~~~~~rg~av~~~~v~v~t-------~dg~l~ALDa~TGk 141 (527)
T TIGR03075 69 DGVMYVTTSYSRVYALDAKTGKELWKYDPKLPDDVIPVMCCDVVNRGVALYDGKVFFGT-------LDARLVALDAKTGK 141 (527)
T ss_pred CCEEEEECCCCcEEEEECCCCceeeEecCCCCcccccccccccccccceEECCEEEEEc-------CCCEEEEEECCCCC
Confidence 4544444444556666777887766554310011110 000 01123344444 46889999999999
Q ss_pred EEEEEeeCC-----ceeE-EEEeCCeEEEEE-------CCEEEEEEcCCcEEEEEEeccCCCC-----------------
Q 020784 168 CIGELSFRS-----EVRS-VKLRRDRIIVVL-------EQKIFVYNFADLKLLHQIETIANPK----------------- 217 (321)
Q Consensus 168 ~~~~~~~~~-----~v~~-v~~~~~~~~~~~-------~~~I~iwd~~~~~~~~~l~~~~~~~----------------- 217 (321)
.+-...... .+.+ -.+..+.+++.. ++.|..+|..+++.+-++.......
T Consensus 142 ~~W~~~~~~~~~~~~~tssP~v~~g~Vivg~~~~~~~~~G~v~AlD~~TG~~lW~~~~~p~~~~~~~~~~~~~~~~~~~~ 221 (527)
T TIGR03075 142 VVWSKKNGDYKAGYTITAAPLVVKGKVITGISGGEFGVRGYVTAYDAKTGKLVWRRYTVPGDMGYLDKADKPVGGEPGAK 221 (527)
T ss_pred EEeecccccccccccccCCcEEECCEEEEeecccccCCCcEEEEEECCCCceeEeccCcCCCcccccccccccccccccC
Confidence 876654321 1111 123345566553 3689999999999888765432110
Q ss_pred ------------ce-EEEeeCCCceEEEe-ecC---CCC-----------cEEEEeeCCcceE-Eee--ccc-------c
Q 020784 218 ------------GL-CAVSQGVGSLVLVC-PGL---QKG-----------QVRVEHYASKRTK-FIM--AHD-------S 259 (321)
Q Consensus 218 ------------~~-~~~s~~~d~~~la~-sGs---~dg-----------~V~i~d~~~~~~~-~l~--~H~-------~ 259 (321)
.+ ...+.+++..++.+ +|. .++ .|.-.|..+++++ .++ .|+ .
T Consensus 222 tw~~~~~~~gg~~~W~~~s~D~~~~lvy~~tGnp~p~~~~~r~gdnl~~~s~vAld~~TG~~~W~~Q~~~~D~wD~d~~~ 301 (527)
T TIGR03075 222 TWPGDAWKTGGGATWGTGSYDPETNLIYFGTGNPSPWNSHLRPGDNLYTSSIVARDPDTGKIKWHYQTTPHDEWDYDGVN 301 (527)
T ss_pred CCCCCccccCCCCccCceeEcCCCCeEEEeCCCCCCCCCCCCCCCCccceeEEEEccccCCEEEeeeCCCCCCccccCCC
Confidence 00 01234443333322 222 112 2222566666655 222 232 1
Q ss_pred ceeEEEECCCCC---EEEEEeCCCcEEEEEEcCCCcEEE
Q 020784 260 RIACFALTQDGQ---LLATSSTKGTLVRIFNTLDGTLLQ 295 (321)
Q Consensus 260 ~V~~vafspdg~---~las~S~Dgt~IrIWd~~tg~~i~ 295 (321)
...-+.+..+|+ .++.+..+|. +.+.|-++|+.+.
T Consensus 302 ~p~l~d~~~~G~~~~~v~~~~K~G~-~~vlDr~tG~~i~ 339 (527)
T TIGR03075 302 EMILFDLKKDGKPRKLLAHADRNGF-FYVLDRTNGKLLS 339 (527)
T ss_pred CcEEEEeccCCcEEEEEEEeCCCce-EEEEECCCCceec
Confidence 122233335776 7888999998 9999999999873
No 380
>KOG2395 consensus Protein involved in vacuole import and degradation [Intracellular trafficking, secretion, and vesicular transport]
Probab=94.14 E-value=0.68 Score=44.17 Aligned_cols=144 Identities=10% Similarity=0.080 Sum_probs=78.4
Q ss_pred CCCEE-EEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCC-c-EEEE
Q 020784 96 DHGCF-AAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQS-R-CIGE 171 (321)
Q Consensus 96 dg~~l-asg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~-~-~~~~ 171 (321)
+..+| ..|.. +++.=.|++.++++-.+.+ ...|..+.+.++...-.+.+.+.....+++.|.-||.+-. . .+.-
T Consensus 344 dsnlil~~~~~~~~l~klDIE~GKIVeEWk~--~~di~mv~~t~d~K~~Ql~~e~TlvGLs~n~vfriDpRv~~~~kl~~ 421 (644)
T KOG2395|consen 344 DSNLILMDGGEQDKLYKLDIERGKIVEEWKF--EDDINMVDITPDFKFAQLTSEQTLVGLSDNSVFRIDPRVQGKNKLAV 421 (644)
T ss_pred ccceEeeCCCCcCcceeeecccceeeeEeec--cCCcceeeccCCcchhcccccccEEeecCCceEEecccccCcceeee
Confidence 33443 34544 6666678899999988888 4558888887665443333322222336799999998732 2 1211
Q ss_pred EeeCC-----ceeEEEEeCCe-EEEEE-CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEE
Q 020784 172 LSFRS-----EVRSVKLRRDR-IIVVL-EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVE 244 (321)
Q Consensus 172 ~~~~~-----~v~~v~~~~~~-~~~~~-~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~ 244 (321)
.+.+. ...|..-..++ +++++ ++.||+||-...+...-|.+-..++.-+.++.++ .+|++ ..+..+.+.
T Consensus 422 ~q~kqy~~k~nFsc~aTT~sG~IvvgS~~GdIRLYdri~~~AKTAlPgLG~~I~hVdvtadG--Kwil~--Tc~tyLlLi 497 (644)
T KOG2395|consen 422 VQSKQYSTKNNFSCFATTESGYIVVGSLKGDIRLYDRIGRRAKTALPGLGDAIKHVDVTADG--KWILA--TCKTYLLLI 497 (644)
T ss_pred eeccccccccccceeeecCCceEEEeecCCcEEeehhhhhhhhhcccccCCceeeEEeeccC--cEEEE--ecccEEEEE
Confidence 22221 23334434444 44444 5799999963222222234444444455555544 66653 444455553
Q ss_pred e
Q 020784 245 H 245 (321)
Q Consensus 245 d 245 (321)
+
T Consensus 498 ~ 498 (644)
T KOG2395|consen 498 D 498 (644)
T ss_pred E
Confidence 3
No 381
>KOG1898 consensus Splicing factor 3b, subunit 3 [RNA processing and modification]
Probab=94.02 E-value=3.3 Score=42.86 Aligned_cols=129 Identities=13% Similarity=0.124 Sum_probs=80.2
Q ss_pred CCCcEEEEeCC-CCc---EEEEEeeCCceeEEEEeCCeEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCce
Q 020784 154 PLNKVMIWDDH-QSR---CIGELSFRSEVRSVKLRRDRIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSL 229 (321)
Q Consensus 154 ~d~~v~iWD~~-~~~---~~~~~~~~~~v~~v~~~~~~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~ 229 (321)
.++.+..|++. +|+ .+........|.+++-..++++++-++.+++||+.+.+++++.....-+..+..+.... .
T Consensus 910 ~~g~~ytyk~~~~g~~lellh~T~~~~~v~Ai~~f~~~~LagvG~~l~~YdlG~K~lLRk~e~k~~p~~Is~iqt~~--~ 987 (1205)
T KOG1898|consen 910 SSGFVYTYKFVRNGDKLELLHKTEIPGPVGAICPFQGRVLAGVGRFLRLYDLGKKKLLRKCELKFIPNRISSIQTYG--A 987 (1205)
T ss_pred CCCceEEEEEEecCceeeeeeccCCCccceEEeccCCEEEEecccEEEEeeCChHHHHhhhhhccCceEEEEEeecc--e
Confidence 34667777754 344 22233344578888877778888888999999999888887766544445555665544 3
Q ss_pred EEEeecCCCCcEEE--EeeCCcceEEeec--cccceeEEEECCCCCEEEEEeCCCcEEEEEEcC
Q 020784 230 VLVCPGLQKGQVRV--EHYASKRTKFIMA--HDSRIACFALTQDGQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 230 ~la~sGs~dg~V~i--~d~~~~~~~~l~~--H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~ 289 (321)
-+++ |+..-.|.+ |+-..+.+.++.. -.+.|+++.+- |...+|.|..=|. +|=++
T Consensus 988 RI~V-gD~qeSV~~~~y~~~~n~l~~fadD~~pR~Vt~~~~l-D~~tvagaDrfGN---i~~vR 1046 (1205)
T KOG1898|consen 988 RIVV-GDIQESVHFVRYRREDNQLIVFADDPVPRHVTALELL-DYDTVAGADRFGN---IAVVR 1046 (1205)
T ss_pred EEEE-eeccceEEEEEEecCCCeEEEEeCCCccceeeEEEEe-cCCceeeccccCc---EEEEE
Confidence 4443 555445555 7766666766643 34567777665 3445665544444 56554
No 382
>KOG2444 consensus WD40 repeat protein [General function prediction only]
Probab=93.99 E-value=0.15 Score=43.32 Aligned_cols=135 Identities=13% Similarity=0.130 Sum_probs=71.6
Q ss_pred CCCcEEEEeCCCCcEEE-EEeeCCceeEEEEeCCeEEEE-ECCEEEEEEcCCcEEE-EEEeccCCCCceEEEeeCCCceE
Q 020784 154 PLNKVMIWDDHQSRCIG-ELSFRSEVRSVKLRRDRIIVV-LEQKIFVYNFADLKLL-HQIETIANPKGLCAVSQGVGSLV 230 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~-~~~~~~~v~~v~~~~~~~~~~-~~~~I~iwd~~~~~~~-~~l~~~~~~~~~~~~s~~~d~~~ 230 (321)
.++.|+-++++..+... .-.+...-..+.-....++++ +++.|.+|+....... ..+...... ..+.| +..+...
T Consensus 38 a~~~v~~~~~~k~k~s~rse~~~~e~~~v~~~~~~~~vG~~dg~v~~~n~n~~g~~~d~~~s~~e~-i~~~I-p~~~~~~ 115 (238)
T KOG2444|consen 38 ADGLVRERKVRKHKESCRSERFIDEGQRVVTASAKLMVGTSDGAVYVFNWNLEGAHSDRVCSGEES-IDLGI-PNGRDSS 115 (238)
T ss_pred CCcccccchhhhhhhhhhhhhhhhcceeecccCceEEeecccceEEEecCCccchHHHhhhccccc-ceecc-ccccccc
Confidence 35667777665433211 111111112333223344454 4678888887521111 111111111 12333 3333333
Q ss_pred EEeecCCCCcEEEEeeCCcceE-Eeeccc-cceeEEEECCCCCEEEEE--eCCCcEEEEEEcCCC
Q 020784 231 LVCPGLQKGQVRVEHYASKRTK-FIMAHD-SRIACFALTQDGQLLATS--STKGTLVRIFNTLDG 291 (321)
Q Consensus 231 la~sGs~dg~V~i~d~~~~~~~-~l~~H~-~~V~~vafspdg~~las~--S~Dgt~IrIWd~~tg 291 (321)
+++.|..||.|+-|+....... ..-+|. ..+.....+..++.++.+ |.|.. ++.|++..-
T Consensus 116 ~~c~~~~dg~ir~~n~~p~k~~g~~g~h~~~~~e~~ivv~sd~~i~~a~~S~d~~-~k~W~ve~~ 179 (238)
T KOG2444|consen 116 LGCVGAQDGRIRACNIKPNKVLGYVGQHNFESGEELIVVGSDEFLKIADTSHDRV-LKKWNVEKI 179 (238)
T ss_pred eeEEeccCCceeeeccccCceeeeeccccCCCcceeEEecCCceEEeeccccchh-hhhcchhhh
Confidence 4556999999999988765543 344566 566666666667777777 77877 888887653
No 383
>TIGR02276 beta_rpt_yvtn 40-residue YVTN family beta-propeller repeat. This repeat of about 40 amino acids is found in up to 14 copies per protein. Archaea Methanosarcina mazei and Methanosarcina acetivorans each have over 10 genes that encode tandem copies of this repeat, which is also found in other species. PSIPRED predicts with high confidence that each 40-residue repeats contains four beta strands. This model overlaps somewhat with the NHL repeat (Pfam pfam01436) and also shows sequence similarity to the WD domain, G-beta repeat (Pfam pfam00400).
Probab=93.95 E-value=0.41 Score=28.81 Aligned_cols=40 Identities=18% Similarity=0.191 Sum_probs=29.4
Q ss_pred CCCCEEEEE-eCCCcEEEEEEcCCCcEEEEEeCCCcceeEEE
Q 020784 268 QDGQLLATS-STKGTLVRIFNTLDGTLLQEECCPSISAQSGL 308 (321)
Q Consensus 268 pdg~~las~-S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~~~~ 308 (321)
|+|++|..+ -.+++ |.++|..+++.+.++..|.....+.+
T Consensus 1 pd~~~lyv~~~~~~~-v~~id~~~~~~~~~i~vg~~P~~i~~ 41 (42)
T TIGR02276 1 PDGTKLYVTNSGSNT-VSVIDTATNKVIATIPVGGYPFGVAV 41 (42)
T ss_pred CCCCEEEEEeCCCCE-EEEEECCCCeEEEEEECCCCCceEEe
Confidence 567655544 44666 99999999999999988766655544
No 384
>KOG2079 consensus Vacuolar assembly/sorting protein VPS8 [Intracellular trafficking, secretion, and vesicular transport]
Probab=93.71 E-value=0.32 Score=49.93 Aligned_cols=106 Identities=23% Similarity=0.305 Sum_probs=63.4
Q ss_pred eeEEEEeCCeEEEEEC-CEEEEEEcCCc-EEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcc-eEEe
Q 020784 178 VRSVKLRRDRIIVVLE-QKIFVYNFADL-KLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKR-TKFI 254 (321)
Q Consensus 178 v~~v~~~~~~~~~~~~-~~I~iwd~~~~-~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~-~~~l 254 (321)
+.+.+.-.-.++++++ +.|-..|+... ...+.=+....++..++|+. ++.+++ .|-.+|.|.+||...++ ++.+
T Consensus 92 v~s~a~~~~~ivi~Ts~ghvl~~d~~~nL~~~~~ne~v~~~Vtsvafn~--dg~~l~-~G~~~G~V~v~D~~~~k~l~~i 168 (1206)
T KOG2079|consen 92 VISSAIVVVPIVIGTSHGHVLLSDMTGNLGPLHQNERVQGPVTSVAFNQ--DGSLLL-AGLGDGHVTVWDMHRAKILKVI 168 (1206)
T ss_pred eeeeeeeeeeEEEEcCchhhhhhhhhcccchhhcCCccCCcceeeEecC--CCceec-cccCCCcEEEEEccCCcceeee
Confidence 4444444445666666 47777777542 11111112223444555554 568887 49999999999998754 6777
Q ss_pred eccccceeEEEEC---CCCCEEEEEeCCCcEEEEEEcC
Q 020784 255 MAHDSRIACFALT---QDGQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 255 ~~H~~~V~~vafs---pdg~~las~S~Dgt~IrIWd~~ 289 (321)
..|..+++.+-+. .++..+.|+...|. +|.+.
T Consensus 169 ~e~~ap~t~vi~v~~t~~nS~llt~D~~Gs---f~~lv 203 (1206)
T KOG2079|consen 169 TEHGAPVTGVIFVGRTSQNSKLLTSDTGGS---FWKLV 203 (1206)
T ss_pred eecCCccceEEEEEEeCCCcEEEEccCCCc---eEEEE
Confidence 7777666555443 44556777655554 67653
No 385
>KOG1008 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=93.67 E-value=0.0084 Score=57.68 Aligned_cols=157 Identities=16% Similarity=0.122 Sum_probs=88.4
Q ss_pred CCCCCeEEEEEcC-CCCEEEEEcCC----c-EEEEEecCC--ceeEEeeee--cCCceEEEEEecCCCeEEEEeCCCCCC
Q 020784 83 SPPPTLLHISFNQ-DHGCFAAGTDH----G-FRIYNCDPF--REIFRRDFE--RGGGIGVVEMLFRCNILALVGGGPDPQ 152 (321)
Q Consensus 83 ~~~~~V~~v~fs~-dg~~lasg~~~----g-v~vw~~~~~--~~~~~~~~~--~~~~v~~v~~~~~~~~~~~~sg~~~~~ 152 (321)
.+....++++|++ |..+||.|-++ . +.|||..+. ...-...|. ...+...++|.-+..++..+.
T Consensus 100 ~~ar~Ct~lAwneLDtn~LAagldkhrnds~~~Iwdi~s~ltvPke~~~fs~~~l~gqns~cwlrd~klvlaGm------ 173 (783)
T KOG1008|consen 100 GYARPCTSLAWNELDTNHLAAGLDKHRNDSSLKIWDINSLLTVPKESPLFSSSTLDGQNSVCWLRDTKLVLAGM------ 173 (783)
T ss_pred cccccccccccccccHHHHHhhhhhhcccCCccceecccccCCCccccccccccccCccccccccCcchhhccc------
Confidence 4445889999998 67789988752 2 779998765 111111121 123445667764444443333
Q ss_pred CCCCcEEEEeCCCCcEEEEEeeCCceeEEEE---eCCeEEEEECCEEEEEE-cCCc-EEEEEEeccCC----CCceEEEe
Q 020784 153 YPLNKVMIWDDHQSRCIGELSFRSEVRSVKL---RRDRIIVVLEQKIFVYN-FADL-KLLHQIETIAN----PKGLCAVS 223 (321)
Q Consensus 153 ~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~---~~~~~~~~~~~~I~iwd-~~~~-~~~~~l~~~~~----~~~~~~~s 223 (321)
..+.++++|++........--...|..+.+ .++.++.-.++.|-+|| .++. ..++.+....+ ....++++
T Consensus 174 -~sr~~~ifdlRqs~~~~~svnTk~vqG~tVdp~~~nY~cs~~dg~iAiwD~~rnienpl~~i~~~~N~~~~~l~~~ayc 252 (783)
T KOG1008|consen 174 -TSRSVHIFDLRQSLDSVSSVNTKYVQGITVDPFSPNYFCSNSDGDIAIWDTYRNIENPLQIILRNENKKPKQLFALAYC 252 (783)
T ss_pred -ccchhhhhhhhhhhhhhhhhhhhhcccceecCCCCCceeccccCceeeccchhhhccHHHHHhhCCCCcccceeeEEec
Confidence 347899999874332111111123444444 45666666789999999 3332 22333322222 24566777
Q ss_pred eCCCceEEEeecCCCCcEEEEeeC
Q 020784 224 QGVGSLVLVCPGLQKGQVRVEHYA 247 (321)
Q Consensus 224 ~~~d~~~la~sGs~dg~V~i~d~~ 247 (321)
+.-.|.+.++ -...++|+.+++.
T Consensus 253 Ptrtglla~l-~RdS~tIrlydi~ 275 (783)
T KOG1008|consen 253 PTRTGLLAVL-SRDSITIRLYDIC 275 (783)
T ss_pred cCCcchhhhh-ccCcceEEEeccc
Confidence 7665555443 4556788888764
No 386
>PF14727 PHTB1_N: PTHB1 N-terminus
Probab=93.31 E-value=6.3 Score=37.29 Aligned_cols=133 Identities=13% Similarity=0.067 Sum_probs=78.1
Q ss_pred CCCcEEEEeCCCCc-----EEEEEeeCCceeEEEEeC-------CeEEEEECCEEEEEEcCC--cE-------EEEEEec
Q 020784 154 PLNKVMIWDDHQSR-----CIGELSFRSEVRSVKLRR-------DRIIVVLEQKIFVYNFAD--LK-------LLHQIET 212 (321)
Q Consensus 154 ~d~~v~iWD~~~~~-----~~~~~~~~~~v~~v~~~~-------~~~~~~~~~~I~iwd~~~--~~-------~~~~l~~ 212 (321)
..|.+||++...+. .+.+.++..+|.++...+ ..+++..-.++.+|.+.. +. .+..+-.
T Consensus 45 ~~G~LrIy~P~~~~~~~~~lllE~~l~~PILqv~~G~F~s~~~~~~LaVLhP~kl~vY~v~~~~g~~~~g~~~~L~~~ye 124 (418)
T PF14727_consen 45 YSGILRIYDPSGNEFQPEDLLLETQLKDPILQVECGKFVSGSEDLQLAVLHPRKLSVYSVSLVDGTVEHGNQYQLELIYE 124 (418)
T ss_pred cccEEEEEccCCCCCCCccEEEEEecCCcEEEEEeccccCCCCcceEEEecCCEEEEEEEEecCCCcccCcEEEEEEEEE
Confidence 56999999975433 566777888999988653 245666678999998821 11 1122222
Q ss_pred cCC---CCceEEEeeCCC--ceEEEeecCCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEE
Q 020784 213 IAN---PKGLCAVSQGVG--SLVLVCPGLQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 213 ~~~---~~~~~~~s~~~d--~~~la~sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd 287 (321)
|.- ....|.-.+.+- ...++ .=+-||++.+++-..-....+-..---.-.++|.+.-..|++++.+.. +.-+.
T Consensus 125 h~l~~~a~nm~~G~Fgg~~~~~~Ic-VQS~DG~L~~feqe~~~f~~~lp~~llPgPl~Y~~~tDsfvt~sss~~-l~~Yk 202 (418)
T PF14727_consen 125 HSLQRTAYNMCCGPFGGVKGRDFIC-VQSMDGSLSFFEQESFAFSRFLPDFLLPGPLCYCPRTDSFVTASSSWT-LECYK 202 (418)
T ss_pred EecccceeEEEEEECCCCCCceEEE-EEecCceEEEEeCCcEEEEEEcCCCCCCcCeEEeecCCEEEEecCcee-EEEec
Confidence 221 122222222221 23444 378899999987544332222222333456777777777888877766 66665
Q ss_pred c
Q 020784 288 T 288 (321)
Q Consensus 288 ~ 288 (321)
.
T Consensus 203 y 203 (418)
T PF14727_consen 203 Y 203 (418)
T ss_pred H
Confidence 4
No 387
>PRK13616 lipoprotein LpqB; Provisional
Probab=93.29 E-value=9.5 Score=37.93 Aligned_cols=179 Identities=9% Similarity=0.051 Sum_probs=90.7
Q ss_pred CeEEEEEcCCCCEEEEEc------CCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCC-----CC
Q 020784 87 TLLHISFNQDHGCFAAGT------DHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQ-----YP 154 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~------~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~-----~~ 154 (321)
.+...+++|||+.+|.-. ++. -.||-....+....... +.....-.|++++..++++..+.... ..
T Consensus 351 ~vsspaiSpdG~~vA~v~~~~~~~~d~~s~Lwv~~~gg~~~~lt~--g~~~t~PsWspDG~~lw~v~dg~~~~~v~~~~~ 428 (591)
T PRK13616 351 NITSAALSRSGRQVAAVVTLGRGAPDPASSLWVGPLGGVAVQVLE--GHSLTRPSWSLDADAVWVVVDGNTVVRVIRDPA 428 (591)
T ss_pred CcccceECCCCCEEEEEEeecCCCCCcceEEEEEeCCCcceeeec--CCCCCCceECCCCCceEEEecCcceEEEeccCC
Confidence 678899999999887554 232 34665543332222221 23344556777777777765331000 01
Q ss_pred CCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCe--EEEEECCEEEEE---EcCCcEEEEEE------eccCCCCceEEEe
Q 020784 155 LNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDR--IIVVLEQKIFVY---NFADLKLLHQI------ETIANPKGLCAVS 223 (321)
Q Consensus 155 d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~--~~~~~~~~I~iw---d~~~~~~~~~l------~~~~~~~~~~~~s 223 (321)
.+.+.+.+++.+.... .+...|..+.|+++. ++...+++|.+= ....++ ..+ ..... .....+.
T Consensus 429 ~gql~~~~vd~ge~~~--~~~g~Issl~wSpDG~RiA~i~~g~v~Va~Vvr~~~G~--~~l~~~~~l~~~l~-~~~~~l~ 503 (591)
T PRK13616 429 TGQLARTPVDASAVAS--RVPGPISELQLSRDGVRAAMIIGGKVYLAVVEQTEDGQ--YALTNPREVGPGLG-DTAVSLD 503 (591)
T ss_pred CceEEEEeccCchhhh--ccCCCcCeEEECCCCCEEEEEECCEEEEEEEEeCCCCc--eeecccEEeecccC-Cccccce
Confidence 2344444555544433 445679999998864 555556776663 323343 222 11111 1123445
Q ss_pred eCCCceEEEeecCCCCcEEEEeeC--CcceEEeec--cccceeEEEECCCCCEEEE
Q 020784 224 QGVGSLVLVCPGLQKGQVRVEHYA--SKRTKFIMA--HDSRIACFALTQDGQLLAT 275 (321)
Q Consensus 224 ~~~d~~~la~sGs~dg~V~i~d~~--~~~~~~l~~--H~~~V~~vafspdg~~las 275 (321)
+.+++.+++ +..++...+|.+. ......+.. ....|.+|+=+++ .++++
T Consensus 504 W~~~~~L~V--~~~~~~~~v~~v~vDG~~~~~~~~~n~~~~v~~vaa~~~-~iyv~ 556 (591)
T PRK13616 504 WRTGDSLVV--GRSDPEHPVWYVNLDGSNSDALPSRNLSAPVVAVAASPS-TVYVT 556 (591)
T ss_pred EecCCEEEE--EecCCCCceEEEecCCccccccCCCCccCceEEEecCCc-eEEEE
Confidence 555666654 3333434444332 222222233 3567888887763 44443
No 388
>KOG3617 consensus WD40 and TPR repeat-containing protein [General function prediction only]
Probab=93.14 E-value=0.096 Score=52.32 Aligned_cols=103 Identities=16% Similarity=0.232 Sum_probs=74.8
Q ss_pred EEEeCCe--EEEEE-----CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEE
Q 020784 181 VKLRRDR--IIVVL-----EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKF 253 (321)
Q Consensus 181 v~~~~~~--~~~~~-----~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~ 253 (321)
..|||.. ++++. .+.|.||- .+|+.-+.+. .|+...+++++|...+|+ +|-.-|.+.+|..+.+..++
T Consensus 21 ~SWHPsePlfAVA~fS~er~GSVtIfa-dtGEPqr~Vt---~P~hatSLCWHpe~~vLa-~gwe~g~~~v~~~~~~e~ht 95 (1416)
T KOG3617|consen 21 SSWHPSEPLFAVASFSPERGGSVTIFA-DTGEPQRDVT---YPVHATSLCWHPEEFVLA-QGWEMGVSDVQKTNTTETHT 95 (1416)
T ss_pred cccCCCCceeEEEEecCCCCceEEEEe-cCCCCCcccc---cceehhhhccChHHHHHh-hccccceeEEEecCCceeee
Confidence 4566643 44442 36777774 2333322222 245556677788777777 59999999999988877664
Q ss_pred -eeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcC
Q 020784 254 -IMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 254 -l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~ 289 (321)
-..|..+|.-+.||++|..|+|+..-|. |.+|...
T Consensus 96 v~~th~a~i~~l~wS~~G~~l~t~d~~g~-v~lwr~d 131 (1416)
T KOG3617|consen 96 VVETHPAPIQGLDWSHDGTVLMTLDNPGS-VHLWRYD 131 (1416)
T ss_pred eccCCCCCceeEEecCCCCeEEEcCCCce-eEEEEee
Confidence 4569999999999999999999999998 9999876
No 389
>PHA03098 kelch-like protein; Provisional
Probab=92.72 E-value=11 Score=36.94 Aligned_cols=130 Identities=13% Similarity=0.146 Sum_probs=62.5
Q ss_pred CcEEEEeCCCCcEEEEEeeC--CceeEEEEeCCeEEEEEC--------CEEEEEEcCCcEEEEEEeccCCCC-ceEEEee
Q 020784 156 NKVMIWDDHQSRCIGELSFR--SEVRSVKLRRDRIIVVLE--------QKIFVYNFADLKLLHQIETIANPK-GLCAVSQ 224 (321)
Q Consensus 156 ~~v~iWD~~~~~~~~~~~~~--~~v~~v~~~~~~~~~~~~--------~~I~iwd~~~~~~~~~l~~~~~~~-~~~~~s~ 224 (321)
+.+-.||..+++....-... ..-.++....+.+++.++ +.+..||..+.+= ..+.....+. ..++...
T Consensus 358 ~~v~~yd~~~~~W~~~~~lp~~r~~~~~~~~~~~iYv~GG~~~~~~~~~~v~~yd~~t~~W-~~~~~~p~~r~~~~~~~~ 436 (534)
T PHA03098 358 NTVESWKPGESKWREEPPLIFPRYNPCVVNVNNLIYVIGGISKNDELLKTVECFSLNTNKW-SKGSPLPISHYGGCAIYH 436 (534)
T ss_pred ceEEEEcCCCCceeeCCCcCcCCccceEEEECCEEEEECCcCCCCcccceEEEEeCCCCee-eecCCCCccccCceEEEE
Confidence 56888998877654322211 111233344556655532 4688889865432 2222111111 2223333
Q ss_pred CCCceEEEeecCCCC--------cEEEEeeCCcceEEee---ccccceeEEEECCCCCEEEEEeCC-----CcEEEEEEc
Q 020784 225 GVGSLVLVCPGLQKG--------QVRVEHYASKRTKFIM---AHDSRIACFALTQDGQLLATSSTK-----GTLVRIFNT 288 (321)
Q Consensus 225 ~~d~~~la~sGs~dg--------~V~i~d~~~~~~~~l~---~H~~~V~~vafspdg~~las~S~D-----gt~IrIWd~ 288 (321)
+ +.+.++ |+.++ .+.++|..+..-..+. ........+.+ ++++++.|+.+ +. |.++|.
T Consensus 437 ~--~~iyv~-GG~~~~~~~~~~~~v~~yd~~~~~W~~~~~~~~~r~~~~~~~~--~~~iyv~GG~~~~~~~~~-v~~yd~ 510 (534)
T PHA03098 437 D--GKIYVI-GGISYIDNIKVYNIVESYNPVTNKWTELSSLNFPRINASLCIF--NNKIYVVGGDKYEYYINE-IEVYDD 510 (534)
T ss_pred C--CEEEEE-CCccCCCCCcccceEEEecCCCCceeeCCCCCcccccceEEEE--CCEEEEEcCCcCCcccce-eEEEeC
Confidence 2 356665 54321 2566776654322221 11111222333 67777778765 34 778887
Q ss_pred CCCc
Q 020784 289 LDGT 292 (321)
Q Consensus 289 ~tg~ 292 (321)
.+.+
T Consensus 511 ~~~~ 514 (534)
T PHA03098 511 KTNT 514 (534)
T ss_pred CCCE
Confidence 7653
No 390
>KOG1900 consensus Nuclear pore complex, Nup155 component (D Nup154, sc Nup157/Nup170) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=92.68 E-value=2.5 Score=44.66 Aligned_cols=134 Identities=11% Similarity=0.164 Sum_probs=83.3
Q ss_pred CCCcEEEEeCCCCcEEEEEee-CCceeEEEEe-C----------CeEEEEECCEEEEEEcC----CcE---EEEEEeccC
Q 020784 154 PLNKVMIWDDHQSRCIGELSF-RSEVRSVKLR-R----------DRIIVVLEQKIFVYNFA----DLK---LLHQIETIA 214 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~~~~~-~~~v~~v~~~-~----------~~~~~~~~~~I~iwd~~----~~~---~~~~l~~~~ 214 (321)
.|+.+.+|+.+++.....+.. ...|..|..- + ..+++++-..|.++-+. ++. ....++-..
T Consensus 97 iDn~L~lWny~~~~e~~~~d~~shtIl~V~LvkPkpgvFv~~IqhlLvvaT~~ei~ilgV~~~~~~~~~~~f~~~~~i~~ 176 (1311)
T KOG1900|consen 97 IDNNLFLWNYESDNELAEYDGLSHTILKVGLVKPKPGVFVPEIQHLLVVATPVEIVILGVSFDEFTGELSIFNTSFKISV 176 (1311)
T ss_pred eCCeEEEEEcCCCCccccccchhhhheeeeeecCCCCcchhhhheeEEecccceEEEEEEEeccccCcccccccceeeec
Confidence 579999999998766655543 3456666642 2 13566676677777542 111 111122224
Q ss_pred CCCceEEEeeCCCceEEEeecCCCCcE-EE-EeeCC----c-----------------ceEEee-ccccceeEEEECCCC
Q 020784 215 NPKGLCAVSQGVGSLVLVCPGLQKGQV-RV-EHYAS----K-----------------RTKFIM-AHDSRIACFALTQDG 270 (321)
Q Consensus 215 ~~~~~~~~s~~~d~~~la~sGs~dg~V-~i-~d~~~----~-----------------~~~~l~-~H~~~V~~vafspdg 270 (321)
+.+.+.++....+|.++. |+.||.| .+ |.... + .+..+. .|..+|..+++....
T Consensus 177 dg~~V~~I~~t~nGRIF~--~G~dg~lyEl~Yq~~~gWf~~rc~Kiclt~s~ls~lvPs~~~~~~~~~dpI~qi~ID~SR 254 (1311)
T KOG1900|consen 177 DGVSVNCITYTENGRIFF--AGRDGNLYELVYQAEDGWFGSRCRKICLTKSVLSSLVPSLLSVPGSSKDPIRQITIDNSR 254 (1311)
T ss_pred CCceEEEEEeccCCcEEE--eecCCCEEEEEEeccCchhhcccccccCchhHHHHhhhhhhcCCCCCCCcceeeEecccc
Confidence 455666666666777776 3445532 22 22111 0 111233 578899999999888
Q ss_pred CEEEEEeCCCcEEEEEEcCC
Q 020784 271 QLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 271 ~~las~S~Dgt~IrIWd~~t 290 (321)
..|-+-++.|+ |++||+..
T Consensus 255 ~IlY~lsek~~-v~~Y~i~~ 273 (1311)
T KOG1900|consen 255 NILYVLSEKGT-VSAYDIGG 273 (1311)
T ss_pred ceeeeeccCce-EEEEEccC
Confidence 89999999999 99999986
No 391
>PF02897 Peptidase_S9_N: Prolyl oligopeptidase, N-terminal beta-propeller domain; InterPro: IPR004106 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This entry represents the beta-propeller domain found at the N-terminal of prolyl oligopeptidase, including acylamino-acid-releasing enzyme (also known as acylaminoacyl peptidase), which belong to the MEROPS peptidase family S9 (clan SC), subfamily S9A. The prolyl oligopeptidase family consist of a number of evolutionary related peptidases whose catalytic activity seems to be provided by a charge relay system similar to that of the trypsin family of serine proteases, but which evolved by independent convergent evolution. The N-terminal domain of prolyl oligopeptidases form an unusual 7-bladed beta-propeller consisting of seven 4-stranded beta-sheet motifs. Prolyl oligopeptidase is a large cytosolic enzyme involved in the maturation and degradation of peptide hormones and neuropeptides, which relate to the induction of amnesia. The enzyme contains a peptidase domain, where its catalytic triad (Ser554, His680, Asp641) is covered by the central tunnel of the N-terminal beta-propeller domain. In this way, large structured peptides are excluded from the active site, thereby protecting larger peptides and proteins from proteolysis in the cytosol []. The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. Mammalian acylaminoacyl peptidase is an exopeptidase that is a member of the same prolyl oligopeptidase family of serine peptidases. This enzyme removes acylated amino acid residues from the N terminus of oligopeptides [].; GO: 0004252 serine-type endopeptidase activity, 0006508 proteolysis; PDB: 2BKL_B 3DDU_A 1YR2_A 2XE4_A 1VZ3_A 3EQ9_A 1O6F_A 3EQ7_A 4AN0_A 1UOP_A ....
Probab=92.53 E-value=9.3 Score=35.87 Aligned_cols=207 Identities=11% Similarity=0.058 Sum_probs=102.6
Q ss_pred CeEEEEEcCCCCEEEEEcC-C-----cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCC----CCCCC
Q 020784 87 TLLHISFNQDHGCFAAGTD-H-----GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDP----QYPLN 156 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~-~-----gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~----~~~d~ 156 (321)
.+...+++|||++||-+-+ + .++|+|+++++.+... + .......+.|..++..+....-.... .....
T Consensus 125 ~~~~~~~Spdg~~la~~~s~~G~e~~~l~v~Dl~tg~~l~d~-i-~~~~~~~~~W~~d~~~~~y~~~~~~~~~~~~~~~~ 202 (414)
T PF02897_consen 125 SLGGFSVSPDGKRLAYSLSDGGSEWYTLRVFDLETGKFLPDG-I-ENPKFSSVSWSDDGKGFFYTRFDEDQRTSDSGYPR 202 (414)
T ss_dssp EEEEEEETTTSSEEEEEEEETTSSEEEEEEEETTTTEEEEEE-E-EEEESEEEEECTTSSEEEEEECSTTTSS-CCGCCE
T ss_pred EeeeeeECCCCCEEEEEecCCCCceEEEEEEECCCCcCcCCc-c-cccccceEEEeCCCCEEEEEEeCcccccccCCCCc
Confidence 3446789999999986533 2 2679999998654322 1 01112237888888877666533210 00156
Q ss_pred cEEEEeCCCCcE--EEEEeeCC--c-eeEEEEeCC--eEEEE-E---C-CEEEEEEcCCc----EEEEEEeccCCCCceE
Q 020784 157 KVMIWDDHQSRC--IGELSFRS--E-VRSVKLRRD--RIIVV-L---E-QKIFVYNFADL----KLLHQIETIANPKGLC 220 (321)
Q Consensus 157 ~v~iWD~~~~~~--~~~~~~~~--~-v~~v~~~~~--~~~~~-~---~-~~I~iwd~~~~----~~~~~l~~~~~~~~~~ 220 (321)
.|..|++.+... ...++... . ...+..+.+ .+++. . . ..+.+.++..+ ...+.+....... ..
T Consensus 203 ~v~~~~~gt~~~~d~lvfe~~~~~~~~~~~~~s~d~~~l~i~~~~~~~~s~v~~~d~~~~~~~~~~~~~l~~~~~~~-~~ 281 (414)
T PF02897_consen 203 QVYRHKLGTPQSEDELVFEEPDEPFWFVSVSRSKDGRYLFISSSSGTSESEVYLLDLDDGGSPDAKPKLLSPREDGV-EY 281 (414)
T ss_dssp EEEEEETTS-GGG-EEEEC-TTCTTSEEEEEE-TTSSEEEEEEESSSSEEEEEEEECCCTTTSS-SEEEEEESSSS--EE
T ss_pred EEEEEECCCChHhCeeEEeecCCCcEEEEEEecCcccEEEEEEEccccCCeEEEEeccccCCCcCCcEEEeCCCCce-EE
Confidence 789999877642 23333322 2 445666654 34433 2 2 36788888764 2233333222211 11
Q ss_pred EEeeCCCceEEEeecC--CCCcEEEEeeCCcc----eEEeeccccc--eeEEEECCCCCEEEEEeCCC-cEEEEEEcCCC
Q 020784 221 AVSQGVGSLVLVCPGL--QKGQVRVEHYASKR----TKFIMAHDSR--IACFALTQDGQLLATSSTKG-TLVRIFNTLDG 291 (321)
Q Consensus 221 ~~s~~~d~~~la~sGs--~dg~V~i~d~~~~~----~~~l~~H~~~--V~~vafspdg~~las~S~Dg-t~IrIWd~~tg 291 (321)
.+...++ .+++.+.. .++.|.-.++.... ...+-.|... +..+.... +.+++....++ ..|+|+++..+
T Consensus 282 ~v~~~~~-~~yi~Tn~~a~~~~l~~~~l~~~~~~~~~~~l~~~~~~~~l~~~~~~~-~~Lvl~~~~~~~~~l~v~~~~~~ 359 (414)
T PF02897_consen 282 YVDHHGD-RLYILTNDDAPNGRLVAVDLADPSPAEWWTVLIPEDEDVSLEDVSLFK-DYLVLSYRENGSSRLRVYDLDDG 359 (414)
T ss_dssp EEEEETT-EEEEEE-TT-TT-EEEEEETTSTSGGGEEEEEE--SSSEEEEEEEEET-TEEEEEEEETTEEEEEEEETT-T
T ss_pred EEEccCC-EEEEeeCCCCCCcEEEEecccccccccceeEEcCCCCceeEEEEEEEC-CEEEEEEEECCccEEEEEECCCC
Confidence 2222233 33333332 23444445555432 2366667664 44554432 33455555444 34788999844
Q ss_pred cEEEEEe
Q 020784 292 TLLQEEC 298 (321)
Q Consensus 292 ~~i~~~~ 298 (321)
.......
T Consensus 360 ~~~~~~~ 366 (414)
T PF02897_consen 360 KESREIP 366 (414)
T ss_dssp EEEEEEE
T ss_pred cEEeeec
Confidence 4444443
No 392
>PF10168 Nup88: Nuclear pore component; InterPro: IPR019321 Nup88 can be divided into two structural domains; the N-terminal two-thirds of the protein have no obvious structural motifs. It is, however, where it binds to Nup98; one of the components of the nuclear pore. The C-terminal end is a predicted coiled-coil domain []. Nup88 is over expressed in tumour cells [].
Probab=92.43 E-value=14 Score=37.63 Aligned_cols=74 Identities=18% Similarity=0.108 Sum_probs=50.7
Q ss_pred CeEEEEEcCCCCEEEEEcCCcEEEEEecC----------C-ceeEEeeee---------cCCceEEEEEecC---CCeEE
Q 020784 87 TLLHISFNQDHGCFAAGTDHGFRIYNCDP----------F-REIFRRDFE---------RGGGIGVVEMLFR---CNILA 143 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~~gv~vw~~~~----------~-~~~~~~~~~---------~~~~v~~v~~~~~---~~~~~ 143 (321)
.|..|.+|++|++||..|..+|.|-.+-. + ..+..+.+. +...|..+.|+|. +..++
T Consensus 86 ~v~~i~~n~~g~~lal~G~~~v~V~~LP~r~g~~~~~~~g~~~i~Crt~~v~~~~~~~~~~~~i~qv~WhP~s~~~~~l~ 165 (717)
T PF10168_consen 86 EVHQISLNPTGSLLALVGPRGVVVLELPRRWGKNGEFEDGKKEINCRTVPVDERFFTSNSSLEIKQVRWHPWSESDSHLV 165 (717)
T ss_pred eEEEEEECCCCCEEEEEcCCcEEEEEeccccCccccccCCCcceeEEEEEechhhccCCCCceEEEEEEcCCCCCCCeEE
Confidence 79999999999999999998877665521 1 112222211 2335677788775 36677
Q ss_pred EEeCCCCCCCCCCcEEEEeCCCCc
Q 020784 144 LVGGGPDPQYPLNKVMIWDDHQSR 167 (321)
Q Consensus 144 ~~sg~~~~~~~d~~v~iWD~~~~~ 167 (321)
+.. +|+++|+||+...+
T Consensus 166 vLt-------sdn~lR~y~~~~~~ 182 (717)
T PF10168_consen 166 VLT-------SDNTLRLYDISDPQ 182 (717)
T ss_pred EEe-------cCCEEEEEecCCCC
Confidence 766 68999999987543
No 393
>KOG4441 consensus Proteins containing BTB/POZ and Kelch domains, involved in regulatory/signal transduction processes [Signal transduction mechanisms; General function prediction only]
Probab=92.06 E-value=8.7 Score=38.05 Aligned_cols=130 Identities=16% Similarity=0.222 Sum_probs=67.5
Q ss_pred CCcEEEEeCCCCcEEEEEee--CCceeEEEEeCCeEEEEEC--------CEEEEEEcCCcE--EEEEEeccCCCCceEEE
Q 020784 155 LNKVMIWDDHQSRCIGELSF--RSEVRSVKLRRDRIIVVLE--------QKIFVYNFADLK--LLHQIETIANPKGLCAV 222 (321)
Q Consensus 155 d~~v~iWD~~~~~~~~~~~~--~~~v~~v~~~~~~~~~~~~--------~~I~iwd~~~~~--~~~~l~~~~~~~~~~~~ 222 (321)
-++|-.||..+.+....-.. ...-.+++.....++++++ +.+..||..+.+ .+..........+++
T Consensus 395 l~svE~YDp~~~~W~~va~m~~~r~~~gv~~~~g~iYi~GG~~~~~~~l~sve~YDP~t~~W~~~~~M~~~R~~~g~a-- 472 (571)
T KOG4441|consen 395 LNSVECYDPVTNKWTPVAPMLTRRSGHGVAVLGGKLYIIGGGDGSSNCLNSVECYDPETNTWTLIAPMNTRRSGFGVA-- 472 (571)
T ss_pred cccEEEecCCCCcccccCCCCcceeeeEEEEECCEEEEEcCcCCCccccceEEEEcCCCCceeecCCcccccccceEE--
Confidence 35688888877664322211 1122334445556665543 478899986543 222222222222222
Q ss_pred eeCCCceEEEeecCCCCc-----EEEEeeCCcceEE---eeccccceeEEEECCCCCEEEEEeCCCc----EEEEEEcCC
Q 020784 223 SQGVGSLVLVCPGLQKGQ-----VRVEHYASKRTKF---IMAHDSRIACFALTQDGQLLATSSTKGT----LVRIFNTLD 290 (321)
Q Consensus 223 s~~~d~~~la~sGs~dg~-----V~i~d~~~~~~~~---l~~H~~~V~~vafspdg~~las~S~Dgt----~IrIWd~~t 290 (321)
.. ++.+.++ |+.||. |..+|..+..-.. +....+.+-.++. ++.+.|.|+.||. .|..||-.+
T Consensus 473 ~~--~~~iYvv-GG~~~~~~~~~VE~ydp~~~~W~~v~~m~~~rs~~g~~~~--~~~ly~vGG~~~~~~l~~ve~ydp~~ 547 (571)
T KOG4441|consen 473 VL--NGKIYVV-GGFDGTSALSSVERYDPETNQWTMVAPMTSPRSAVGVVVL--GGKLYAVGGFDGNNNLNTVECYDPET 547 (571)
T ss_pred EE--CCEEEEE-CCccCCCccceEEEEcCCCCceeEcccCccccccccEEEE--CCEEEEEecccCccccceeEEcCCCC
Confidence 22 2367775 777762 5557766654332 2223333434443 5778888998883 155555544
Q ss_pred C
Q 020784 291 G 291 (321)
Q Consensus 291 g 291 (321)
.
T Consensus 548 d 548 (571)
T KOG4441|consen 548 D 548 (571)
T ss_pred C
Confidence 3
No 394
>KOG1916 consensus Nuclear protein, contains WD40 repeats [General function prediction only]
Probab=91.97 E-value=0.088 Score=52.90 Aligned_cols=59 Identities=22% Similarity=0.464 Sum_probs=42.3
Q ss_pred eEEEeecCCCCcEEEEeeCCcceEEeeccccceeEEE-----------ECCCCCEEEEEeCCCcEEEEEEcC
Q 020784 229 LVLVCPGLQKGQVRVEHYASKRTKFIMAHDSRIACFA-----------LTQDGQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 229 ~~la~sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~va-----------fspdg~~las~S~Dgt~IrIWd~~ 289 (321)
.++++ |..+|.|++..........+++|...+..++ .||||..||+++.||. ++.|.+.
T Consensus 196 ~~ic~-~~~~~~i~lL~~~ra~~~l~rsHs~~~~d~a~~~~g~~~l~~lSpDGtv~a~a~~dG~-v~f~Qiy 265 (1283)
T KOG1916|consen 196 VYICY-GLKGGEIRLLNINRALRSLFRSHSQRVTDMAFFAEGVLKLASLSPDGTVFAWAISDGS-VGFYQIY 265 (1283)
T ss_pred ceeee-ccCCCceeEeeechHHHHHHHhcCCCcccHHHHhhchhhheeeCCCCcEEEEeecCCc-cceeeee
Confidence 56665 8888999984433333345666876655543 6899999999999998 8888764
No 395
>PF12234 Rav1p_C: RAVE protein 1 C terminal; InterPro: IPR022033 This domain family is found in eukaryotes, and is typically between 621 and 644 amino acids in length. This family is the C-terminal region of the protein RAVE (regulator of the ATPase of vacuolar and endosomal membranes). Rav1p is involved in regulating the glucose dependent assembly and disassembly of vacuolar ATPase V1 and V0 subunits.
Probab=91.63 E-value=4.7 Score=40.04 Aligned_cols=99 Identities=17% Similarity=0.191 Sum_probs=59.5
Q ss_pred CeEEEEEC--CEEEEEEcCCcEEEEEEec-cCCCCceEEEeeCCCceEEEeecCCCCcEEEE-----eeCCc-----ceE
Q 020784 186 DRIIVVLE--QKIFVYNFADLKLLHQIET-IANPKGLCAVSQGVGSLVLVCPGLQKGQVRVE-----HYASK-----RTK 252 (321)
Q Consensus 186 ~~~~~~~~--~~I~iwd~~~~~~~~~l~~-~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~-----d~~~~-----~~~ 252 (321)
++++++.+ ..+.|||.+.+.+...-.. ....+.-.++...+|++.+.+.|.. ..|.++ |+... .+.
T Consensus 41 ~k~a~V~~~~~~LtIWD~~~~~lE~~~~f~~~~~I~dLDWtst~d~qsiLaVGf~-~~v~l~~Q~R~dy~~~~p~w~~i~ 119 (631)
T PF12234_consen 41 KKIAVVDSSRSELTIWDTRSGVLEYEESFSEDDPIRDLDWTSTPDGQSILAVGFP-HHVLLYTQLRYDYTNKGPSWAPIR 119 (631)
T ss_pred CcEEEEECCCCEEEEEEcCCcEEEEeeeecCCCceeeceeeecCCCCEEEEEEcC-cEEEEEEccchhhhcCCcccceeE
Confidence 34555542 4999999988776544332 2334455666667777655544554 466664 22221 122
Q ss_pred --Eeeccc-cceeEEEECCCCCEEEEEeCCCcEEEEEEc
Q 020784 253 --FIMAHD-SRIACFALTQDGQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 253 --~l~~H~-~~V~~vafspdg~~las~S~Dgt~IrIWd~ 288 (321)
.+..|+ .+|.+.+|-++|.+++.++ + ++.|+|-
T Consensus 120 ~i~i~~~T~h~Igds~Wl~~G~LvV~sG--N-qlfv~dk 155 (631)
T PF12234_consen 120 KIDISSHTPHPIGDSIWLKDGTLVVGSG--N-QLFVFDK 155 (631)
T ss_pred EEEeecCCCCCccceeEecCCeEEEEeC--C-EEEEECC
Confidence 244555 6799999999998776443 3 3888874
No 396
>smart00036 CNH Domain found in NIK1-like kinases, mouse citron and yeast ROM1, ROM2. Unpublished observations.
Probab=91.32 E-value=11 Score=34.05 Aligned_cols=64 Identities=14% Similarity=0.181 Sum_probs=44.0
Q ss_pred EcCCCCEEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeC
Q 020784 93 FNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDD 163 (321)
Q Consensus 93 fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~ 163 (321)
+..++++|+.|.+.|+.+.+.........+-+ +...|..+++...-+.+++.+|. ...++++|+
T Consensus 9 ~~~~~~~lL~GTe~Gly~~~~~~~~~~~~kl~-~~~~v~q~~v~~~~~lLi~Lsgk------~~~L~~~~L 72 (302)
T smart00036 9 ITCDGKWLLVGTEEGLYVLNISDQPGTLEKLI-GRRSVTQIWVLEENNVLLMISGK------KPQLYSHPL 72 (302)
T ss_pred cccCCcEEEEEeCCceEEEEcccCCCCeEEec-CcCceEEEEEEhhhCEEEEEeCC------cceEEEEEH
Confidence 34455799999999988777654211222222 35678899998888888888743 234999986
No 397
>PRK13616 lipoprotein LpqB; Provisional
Probab=91.11 E-value=3.7 Score=40.74 Aligned_cols=94 Identities=11% Similarity=0.076 Sum_probs=50.2
Q ss_pred eEEEeeCCCceEEEeecC-----CCCc--EEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEE----
Q 020784 219 LCAVSQGVGSLVLVCPGL-----QKGQ--VRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFN---- 287 (321)
Q Consensus 219 ~~~~s~~~d~~~la~sGs-----~dg~--V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd---- 287 (321)
..+++++ +..+|+... .|+. +.+.+..........+. ..+.-.|+|||..|++.+..+..+++.+
T Consensus 354 spaiSpd--G~~vA~v~~~~~~~~d~~s~Lwv~~~gg~~~~lt~g~--~~t~PsWspDG~~lw~v~dg~~~~~v~~~~~~ 429 (591)
T PRK13616 354 SAALSRS--GRQVAAVVTLGRGAPDPASSLWVGPLGGVAVQVLEGH--SLTRPSWSLDADAVWVVVDGNTVVRVIRDPAT 429 (591)
T ss_pred cceECCC--CCEEEEEEeecCCCCCcceEEEEEeCCCcceeeecCC--CCCCceECCCCCceEEEecCcceEEEeccCCC
Confidence 4456654 455555331 2333 43444432222222332 3788999999998888874323244433
Q ss_pred -------cCCCcEEEEEeCCCcceeEEEeecCceEEEe
Q 020784 288 -------TLDGTLLQEECCPSISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 288 -------~~tg~~i~~~~~g~~~~~~~~s~d~~~la~~ 318 (321)
+..++... ........+.+|+||..||+.
T Consensus 430 gql~~~~vd~ge~~~--~~~g~Issl~wSpDG~RiA~i 465 (591)
T PRK13616 430 GQLARTPVDASAVAS--RVPGPISELQLSRDGVRAAMI 465 (591)
T ss_pred ceEEEEeccCchhhh--ccCCCcCeEEECCCCCEEEEE
Confidence 33222211 112334556889999998874
No 398
>COG5167 VID27 Protein involved in vacuole import and degradation [Intracellular trafficking and secretion]
Probab=90.82 E-value=10 Score=36.48 Aligned_cols=131 Identities=16% Similarity=0.203 Sum_probs=80.1
Q ss_pred CCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCC---------eEEEE-ECCEEEEEEcCC-cEEEEEEeccCCCCceEEE
Q 020784 154 PLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRD---------RIIVV-LEQKIFVYNFAD-LKLLHQIETIANPKGLCAV 222 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~---------~~~~~-~~~~I~iwd~~~-~~~~~~l~~~~~~~~~~~~ 222 (321)
..+.+.-.|++.|+.+.+...+..| -|.+.+. ..+++ ++..|.-.|.+- +..+...+. .....-..|
T Consensus 488 ~~~kLykmDIErGkvveeW~~~ddv-vVqy~p~~kf~qmt~eqtlvGlS~~svFrIDPR~~gNKi~v~es-KdY~tKn~F 565 (776)
T COG5167 488 ERDKLYKMDIERGKVVEEWDLKDDV-VVQYNPYFKFQQMTDEQTLVGLSDYSVFRIDPRARGNKIKVVES-KDYKTKNKF 565 (776)
T ss_pred CcccceeeecccceeeeEeecCCcc-eeecCCchhHHhcCccceEEeecccceEEecccccCCceeeeee-hhccccccc
Confidence 3577888888999999888877766 5555543 33444 455777667642 222222111 111111111
Q ss_pred ee--CCCceEEEeecCCCCcEEEEeeCCcceE-EeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcC
Q 020784 223 SQ--GVGSLVLVCPGLQKGQVRVEHYASKRTK-FIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 223 s~--~~d~~~la~sGs~dg~V~i~d~~~~~~~-~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~ 289 (321)
+. .-.+-++|+ |+..|.|+++|.-....+ .+.+...+|-.|..+.+|.++...+ ..+ +-+-|+.
T Consensus 566 ss~~tTesGyIa~-as~kGDirLyDRig~rAKtalP~lG~aIk~idvta~Gk~ilaTC-k~y-llL~d~~ 632 (776)
T COG5167 566 SSGMTTESGYIAA-ASRKGDIRLYDRIGKRAKTALPGLGDAIKHIDVTANGKHILATC-KNY-LLLTDVP 632 (776)
T ss_pred cccccccCceEEE-ecCCCceeeehhhcchhhhcCcccccceeeeEeecCCcEEEEee-cce-EEEEecc
Confidence 11 112246664 899999999886655544 5778888999999999998765554 444 6677764
No 399
>PF15390 DUF4613: Domain of unknown function (DUF4613)
Probab=90.72 E-value=18 Score=35.50 Aligned_cols=144 Identities=17% Similarity=0.085 Sum_probs=74.3
Q ss_pred CceeEEEEeCC-------eEEEEECCEEEEEEcC-----CcEEEEEEecc---CCCCceEEEeeCCCceEEEeecCCCCc
Q 020784 176 SEVRSVKLRRD-------RIIVVLEQKIFVYNFA-----DLKLLHQIETI---ANPKGLCAVSQGVGSLVLVCPGLQKGQ 240 (321)
Q Consensus 176 ~~v~~v~~~~~-------~~~~~~~~~I~iwd~~-----~~~~~~~l~~~---~~~~~~~~~s~~~d~~~la~sGs~dg~ 240 (321)
.+|.+++|.+- .+++-..+.|.+|.+. +.+.+.....+ .-++.--..-++|...+|++-...|-.
T Consensus 57 EhV~GlsW~P~~~~~~paLLAVQHkkhVtVWqL~~s~~e~~K~l~sQtcEi~e~~pvLpQGCVWHPk~~iL~VLT~~dvS 136 (671)
T PF15390_consen 57 EHVHGLSWAPPCTADTPALLAVQHKKHVTVWQLCPSTTERNKLLMSQTCEIREPFPVLPQGCVWHPKKAILTVLTARDVS 136 (671)
T ss_pred ceeeeeeecCcccCCCCceEEEeccceEEEEEeccCccccccceeeeeeeccCCcccCCCcccccCCCceEEEEecCcee
Confidence 36889999764 2334445799999884 23333332211 112221122234445666653333322
Q ss_pred EEEEeeC--CcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEE-----EEEeCCCcceeEEEeecCc
Q 020784 241 VRVEHYA--SKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLL-----QEECCPSISAQSGLWLSSA 313 (321)
Q Consensus 241 V~i~d~~--~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i-----~~~~~g~~~~~~~~s~d~~ 313 (321)
|. .+.. ...++.=-.-.+-|.|.||.+||+.|+.+=...-.-.|||-....+. -.|..+...+.+. +.-..
T Consensus 137 V~-~sV~~d~srVkaDi~~~G~IhCACWT~DG~RLVVAvGSsLHSyiWd~~qKtL~~CsfcPVFdv~~~Icsi~-AT~ds 214 (671)
T PF15390_consen 137 VL-PSVHCDSSRVKADIKTSGLIHCACWTKDGQRLVVAVGSSLHSYIWDSAQKTLHRCSFCPVFDVGGYICSIE-ATVDS 214 (671)
T ss_pred Ee-eeeeeCCceEEEeccCCceEEEEEecCcCCEEEEEeCCeEEEEEecCchhhhhhCCcceeecCCCceEEEE-Eeccc
Confidence 22 3322 23333222456779999999999987766333333679985533221 1244444433333 23345
Q ss_pred eEEEeecC
Q 020784 314 WLRVLRTL 321 (321)
Q Consensus 314 ~la~~~~~ 321 (321)
.+|+|+-|
T Consensus 215 qVAvaTEL 222 (671)
T PF15390_consen 215 QVAVATEL 222 (671)
T ss_pred eEEEEecC
Confidence 56777644
No 400
>PF14870 PSII_BNR: Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=90.67 E-value=13 Score=33.68 Aligned_cols=187 Identities=11% Similarity=0.117 Sum_probs=80.8
Q ss_pred CCCeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeee-cCC--ceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 85 PPTLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFE-RGG--GIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 85 ~~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~-~~~--~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
...+..|.|..+..-+++|.... |+....++........ ... ......+.+.++...+++ ..+ +.+-
T Consensus 16 ~~~l~dV~F~d~~~G~~VG~~g~--il~T~DGG~tW~~~~~~~~~~~~~~l~~I~f~~~~g~ivG-------~~g-~ll~ 85 (302)
T PF14870_consen 16 DKPLLDVAFVDPNHGWAVGAYGT--ILKTTDGGKTWQPVSLDLDNPFDYHLNSISFDGNEGWIVG-------EPG-LLLH 85 (302)
T ss_dssp SS-EEEEEESSSS-EEEEETTTE--EEEESSTTSS-EE-----S-----EEEEEEEETTEEEEEE-------ETT-EEEE
T ss_pred CCceEEEEEecCCEEEEEecCCE--EEEECCCCccccccccCCCccceeeEEEEEecCCceEEEc-------CCc-eEEE
Confidence 34799999997777788887654 4555444433222110 011 122223334444444444 123 3222
Q ss_pred eCCCCcEEEEEe----eCCceeEEE-EeCCeEEEEECCEEEEEEc-CCcEEEEEEeccCCCCceEEEeeCCCceEEEeec
Q 020784 162 DDHQSRCIGELS----FRSEVRSVK-LRRDRIIVVLEQKIFVYNF-ADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPG 235 (321)
Q Consensus 162 D~~~~~~~~~~~----~~~~v~~v~-~~~~~~~~~~~~~I~iwd~-~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sG 235 (321)
-.+.|+.-..+. .......+. +......++++. -.||-. ..++.-+.+... ....+..+....|+.++++
T Consensus 86 T~DgG~tW~~v~l~~~lpgs~~~i~~l~~~~~~l~~~~-G~iy~T~DgG~tW~~~~~~-~~gs~~~~~r~~dG~~vav-- 161 (302)
T PF14870_consen 86 TTDGGKTWERVPLSSKLPGSPFGITALGDGSAELAGDR-GAIYRTTDGGKTWQAVVSE-TSGSINDITRSSDGRYVAV-- 161 (302)
T ss_dssp ESSTTSS-EE----TT-SS-EEEEEEEETTEEEEEETT---EEEESSTTSSEEEEE-S-----EEEEEE-TTS-EEEE--
T ss_pred ecCCCCCcEEeecCCCCCCCeeEEEEcCCCcEEEEcCC-CcEEEeCCCCCCeeEcccC-CcceeEeEEECCCCcEEEE--
Confidence 233333222222 223333333 233333334332 223333 223332332221 1223455566678888886
Q ss_pred CCCCcEEE-EeeCCcce-EEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEE
Q 020784 236 LQKGQVRV-EHYASKRT-KFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 236 s~dg~V~i-~d~~~~~~-~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd 287 (321)
+..|.+.. |+-....- ..-+.-...|.++.|+|++.+.+.+ ..|. |+.=+
T Consensus 162 s~~G~~~~s~~~G~~~w~~~~r~~~~riq~~gf~~~~~lw~~~-~Gg~-~~~s~ 213 (302)
T PF14870_consen 162 SSRGNFYSSWDPGQTTWQPHNRNSSRRIQSMGFSPDGNLWMLA-RGGQ-IQFSD 213 (302)
T ss_dssp ETTSSEEEEE-TT-SS-EEEE--SSS-EEEEEE-TTS-EEEEE-TTTE-EEEEE
T ss_pred ECcccEEEEecCCCccceEEccCccceehhceecCCCCEEEEe-CCcE-EEEcc
Confidence 56677776 87543321 1222345789999999999887655 5666 76555
No 401
>PF11715 Nup160: Nucleoporin Nup120/160; InterPro: IPR021717 Nup120 is conserved from fungi to plants to humans, and is homologous with the Nup160 of vertebrates. The nuclear core complex, or NPC, mediates macromolecular transport across the nuclear envelope. Deletion of the NUP120 gene causes clustering of NPCs at one side of the nuclear envelope, moderate nucleolar fragmentation and slower cell growth []. The vertebrate NPC is estimated to contain between 30 and 60 different proteins. most of which are not known. Two important ones in creating the nucleoporin basket are Nup98 and Nup153, and Nup120, in conjunction with Nup 133, interacts with these two and itself plays a role in mRNA export []. Nup160, Nup133, Nup96, and Nup107 are all targets of phosphorylation. The phosphorylation sites are clustered mainly at the N-terminal regions of these proteins, which are predicted to be natively disordered. The entire Nup107-160 subcomplex is stable throughout the cell cycle, thus it seems unlikely that phosphorylation affects interactions within the Nup107-160 subcomplex, but rather that it regulates the association of the subcomplex with the NPC and other proteins []. ; PDB: 3F7F_D 3H7N_D 3HXR_A.
Probab=90.33 E-value=0.69 Score=45.44 Aligned_cols=41 Identities=29% Similarity=0.264 Sum_probs=31.2
Q ss_pred cceeEEEECC----CCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCC
Q 020784 259 SRIACFALTQ----DGQLLATSSTKGTLVRIFNTLDGTLLQEECCP 300 (321)
Q Consensus 259 ~~V~~vafsp----dg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g 300 (321)
+.+..++++. +..+|++.+.|++ +||||+.+++++++....
T Consensus 215 ~~~~~~~~~~~~~~~~~~l~tl~~D~~-LRiW~l~t~~~~~~~~~~ 259 (547)
T PF11715_consen 215 SVAASLAVSSSEINDDTFLFTLSRDHT-LRIWSLETGQCLATIDLL 259 (547)
T ss_dssp --EEEEEE-----ETTTEEEEEETTSE-EEEEETTTTCEEEEEETT
T ss_pred CccceEEEecceeCCCCEEEEEeCCCe-EEEEECCCCeEEEEeccc
Confidence 3466677766 6788999999999 999999999998876443
No 402
>PF04841 Vps16_N: Vps16, N-terminal region; InterPro: IPR006926 This protein forms part of the Class C vacuolar protein sorting (Vps) complex. Vps16 is essential for vacuolar protein sorting, which is essential for viability in plants, but not yeast []. The Class C Vps complex is required for SNARE-mediated membrane fusion at the lysosome-like yeast vacuole. It is thought to play essential roles in membrane docking and fusion at the Golgi-to-endosome and endosome-to-vacuole stages of transport []. The role of VPS16 in this complex is not known.; GO: 0006886 intracellular protein transport, 0005737 cytoplasm
Probab=89.83 E-value=18 Score=34.19 Aligned_cols=29 Identities=14% Similarity=0.312 Sum_probs=24.3
Q ss_pred CCeEEEEEcCCCCEEEEEcCCcEEEEEec
Q 020784 86 PTLLHISFNQDHGCFAAGTDHGFRIYNCD 114 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~gv~vw~~~ 114 (321)
++|.++.|+.+.++++.-.++.+++||+.
T Consensus 81 ~~iv~~~wt~~e~LvvV~~dG~v~vy~~~ 109 (410)
T PF04841_consen 81 GRIVGMGWTDDEELVVVQSDGTVRVYDLF 109 (410)
T ss_pred CCEEEEEECCCCeEEEEEcCCEEEEEeCC
Confidence 68999999998887777777778899974
No 403
>TIGR03074 PQQ_membr_DH membrane-bound PQQ-dependent dehydrogenase, glucose/quinate/shikimate family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Members of this family have several predicted transmembrane helices in the N-terminal region, and include the quinoprotein glucose dehydrogenase (EC 1.1.5.2) of Escherichia coli and the quinate/shikimate dehydrogenase of Acinetobacter sp. ADP1 (EC 1.1.99.25). Sequences closely related except for the absense of the N-terminal hydrophobic region, scoring in the gray zone between the trusted and noise cutoffs, include PQQ-dependent glycerol (EC 1.1.99.22) and and other polyol (sugar alcohol) dehydrogenases.
Probab=89.74 E-value=26 Score=35.98 Aligned_cols=143 Identities=10% Similarity=0.129 Sum_probs=77.6
Q ss_pred CCCcEEEEeCCCCcEEEEEeeCCce----------------eE-EEEeCCeEEEEE-----------CCEEEEEEcCCcE
Q 020784 154 PLNKVMIWDDHQSRCIGELSFRSEV----------------RS-VKLRRDRIIVVL-----------EQKIFVYNFADLK 205 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~~~~~~~~v----------------~~-v~~~~~~~~~~~-----------~~~I~iwd~~~~~ 205 (321)
.|+.|.-.|.++|+.+..+..++.| ++ -.+..+.+++.. .+.|+-||..+++
T Consensus 268 ~Dg~LiALDA~TGk~~W~fg~~G~vdl~~~~g~~~~g~~~~ts~P~V~~g~VIvG~~v~d~~~~~~~~G~I~A~Da~TGk 347 (764)
T TIGR03074 268 SDARLIALDADTGKLCEDFGNNGTVDLTAGMGTTPPGYYYPTSPPLVAGTTVVIGGRVADNYSTDEPSGVIRAFDVNTGA 347 (764)
T ss_pred CCCeEEEEECCCCCEEEEecCCCceeeecccCcCCCcccccccCCEEECCEEEEEecccccccccCCCcEEEEEECCCCc
Confidence 5688888899999887665433222 01 112344555542 3679999999999
Q ss_pred EEEEEeccCCC-C--------------ce-EEEeeCCCceEEEe-ecC----------------CCCcEEEEeeCCcceE
Q 020784 206 LLHQIETIANP-K--------------GL-CAVSQGVGSLVLVC-PGL----------------QKGQVRVEHYASKRTK 252 (321)
Q Consensus 206 ~~~~l~~~~~~-~--------------~~-~~~s~~~d~~~la~-sGs----------------~dg~V~i~d~~~~~~~ 252 (321)
++-.+...... . .. ...+.+++..++.+ .|. ..+.|.-.|..+++++
T Consensus 348 l~W~~~~g~p~~~~~~~~g~~~~~gg~n~W~~~s~D~~~glvy~ptGn~~pd~~g~~r~~~~n~y~~slvALD~~TGk~~ 427 (764)
T TIGR03074 348 LVWAWDPGNPDPTAPPAPGETYTRNTPNSWSVASYDEKLGLVYLPMGNQTPDQWGGDRTPADEKYSSSLVALDATTGKER 427 (764)
T ss_pred EeeEEecCCCCcccCCCCCCEeccCCCCccCceEEcCCCCeEEEeCCCccccccCCccccCcccccceEEEEeCCCCceE
Confidence 99888642100 0 00 11222222222221 111 1122222455555544
Q ss_pred -Eeec--cc-------cceeEEEECC-CCC---EEEEEeCCCcEEEEEEcCCCcEEEEE
Q 020784 253 -FIMA--HD-------SRIACFALTQ-DGQ---LLATSSTKGTLVRIFNTLDGTLLQEE 297 (321)
Q Consensus 253 -~l~~--H~-------~~V~~vafsp-dg~---~las~S~Dgt~IrIWd~~tg~~i~~~ 297 (321)
.++. |+ ....-+.+.- +|+ .++.+..+|. +.++|-+||+.+...
T Consensus 428 W~~Q~~~hD~WD~D~~~~p~L~d~~~~~G~~~~~v~~~~K~G~-~~vlDr~tG~~l~~~ 485 (764)
T TIGR03074 428 WVFQTVHHDLWDMDVPAQPSLVDLPDADGTTVPALVAPTKQGQ-IYVLDRRTGEPIVPV 485 (764)
T ss_pred EEecccCCccccccccCCceEEeeecCCCcEeeEEEEECCCCE-EEEEECCCCCEEeec
Confidence 2222 21 1122223332 563 7888999999 999999999998754
No 404
>PF12234 Rav1p_C: RAVE protein 1 C terminal; InterPro: IPR022033 This domain family is found in eukaryotes, and is typically between 621 and 644 amino acids in length. This family is the C-terminal region of the protein RAVE (regulator of the ATPase of vacuolar and endosomal membranes). Rav1p is involved in regulating the glucose dependent assembly and disassembly of vacuolar ATPase V1 and V0 subunits.
Probab=89.62 E-value=11 Score=37.47 Aligned_cols=104 Identities=13% Similarity=0.147 Sum_probs=65.7
Q ss_pred EEEcCCCCEEEEEcC-CcEEEEEecCCceeEEeeeecCCceEEEEEec--CCCeEEEEeCCCCCCCCCCcEEEEeCCC--
Q 020784 91 ISFNQDHGCFAAGTD-HGFRIYNCDPFREIFRRDFERGGGIGVVEMLF--RCNILALVGGGPDPQYPLNKVMIWDDHQ-- 165 (321)
Q Consensus 91 v~fs~dg~~lasg~~-~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~--~~~~~~~~sg~~~~~~~d~~v~iWD~~~-- 165 (321)
+.-+.-++.-++.++ ..+.|||...+..++...+...+.|..++|.. ++..+..+| -.+.|.++--..
T Consensus 35 i~gss~~k~a~V~~~~~~LtIWD~~~~~lE~~~~f~~~~~I~dLDWtst~d~qsiLaVG-------f~~~v~l~~Q~R~d 107 (631)
T PF12234_consen 35 ISGSSIKKIAVVDSSRSELTIWDTRSGVLEYEESFSEDDPIRDLDWTSTPDGQSILAVG-------FPHHVLLYTQLRYD 107 (631)
T ss_pred EeecccCcEEEEECCCCEEEEEEcCCcEEEEeeeecCCCceeeceeeecCCCCEEEEEE-------cCcEEEEEEccchh
Confidence 333444443333333 34779999988887777764567888888854 555555555 467888885311
Q ss_pred -------CcEEEEEee----CCceeEEEEeCCeE-EEEECCEEEEEEc
Q 020784 166 -------SRCIGELSF----RSEVRSVKLRRDRI-IVVLEQKIFVYNF 201 (321)
Q Consensus 166 -------~~~~~~~~~----~~~v~~v~~~~~~~-~~~~~~~I~iwd~ 201 (321)
-..+..+.. ..+|.+..|.+++. +++.++++.|+|-
T Consensus 108 y~~~~p~w~~i~~i~i~~~T~h~Igds~Wl~~G~LvV~sGNqlfv~dk 155 (631)
T PF12234_consen 108 YTNKGPSWAPIRKIDISSHTPHPIGDSIWLKDGTLVVGSGNQLFVFDK 155 (631)
T ss_pred hhcCCcccceeEEEEeecCCCCCccceeEecCCeEEEEeCCEEEEECC
Confidence 112333332 24688888988765 5567789999975
No 405
>TIGR03075 PQQ_enz_alc_DH PQQ-dependent dehydrogenase, methanol/ethanol family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Genes in this family often are found adjacent to the PQQ biosynthesis genes themselves. An unusual, strained disulfide bond between adjacent Cys residues contributes to PQQ-binding, as does a Trp residue that is part of a PQQ enzyme repeat (see pfam01011). Characterized members include the dehydrogenase subunit of a membrane-anchored, three subunit alcohol (ethanol) dehydrogenase of Gluconobacter suboxydans, a homodimeric ethanol dehydrogenase in Pseudomonas aeruginosa, and the large subunit of an alpha2/beta2 heterotetrameric methanol dehydrogenase in Methylobacterium extorquens.
Probab=89.59 E-value=2.4 Score=41.51 Aligned_cols=50 Identities=18% Similarity=0.158 Sum_probs=37.1
Q ss_pred CCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcce--eEEEeecC-ceEEEee
Q 020784 269 DGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISA--QSGLWLSS-AWLRVLR 319 (321)
Q Consensus 269 dg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~--~~~~s~d~-~~la~~~ 319 (321)
.|.++..+..||. ++.+|.+||+.+-+++.+.... -+.+.-+| +|++++.
T Consensus 471 ~g~lvf~g~~~G~-l~a~D~~TGe~lw~~~~g~~~~a~P~ty~~~G~qYv~~~~ 523 (527)
T TIGR03075 471 AGDLVFYGTLEGY-FKAFDAKTGEELWKFKTGSGIVGPPVTYEQDGKQYVAVLS 523 (527)
T ss_pred CCcEEEEECCCCe-EEEEECCCCCEeEEEeCCCCceecCEEEEeCCEEEEEEEe
Confidence 4456666888999 9999999999999888765433 23555777 7777653
No 406
>PF14781 BBS2_N: Ciliary BBSome complex subunit 2, N-terminal
Probab=89.54 E-value=8.6 Score=30.12 Aligned_cols=113 Identities=13% Similarity=0.130 Sum_probs=64.7
Q ss_pred EEEEEcCCCCEEEEEcC-CcEEEEEecCC--------ceeEEeeeecCCceEEEEEec----CCCeEEEEeCCCCCCCCC
Q 020784 89 LHISFNQDHGCFAAGTD-HGFRIYNCDPF--------REIFRRDFERGGGIGVVEMLF----RCNILALVGGGPDPQYPL 155 (321)
Q Consensus 89 ~~v~fs~dg~~lasg~~-~gv~vw~~~~~--------~~~~~~~~~~~~~v~~v~~~~----~~~~~~~~sg~~~~~~~d 155 (321)
..-.|......|++++. +.|.|++-... ..+....+ +..|.+++.-. +..-+.+++ +.
T Consensus 2 aiGkfDG~~pcL~~aT~~gKV~IH~ph~~~~~~~~~~~~i~~LNi--n~~italaaG~l~~~~~~D~LliG-------t~ 72 (136)
T PF14781_consen 2 AIGKFDGVHPCLACATTGGKVFIHNPHERGQRTGRQDSDISFLNI--NQEITALAAGRLKPDDGRDCLLIG-------TQ 72 (136)
T ss_pred eEEEeCCCceeEEEEecCCEEEEECCCccccccccccCceeEEEC--CCceEEEEEEecCCCCCcCEEEEe-------cc
Confidence 44567766778888877 45778864322 12233333 45666665422 122333334 35
Q ss_pred CcEEEEeCCCCcEEEEEeeCCceeEEEEe-----CCeEEEEEC-CEEEEEEcCCcEEEEEE
Q 020784 156 NKVMIWDDHQSRCIGELSFRSEVRSVKLR-----RDRIIVVLE-QKIFVYNFADLKLLHQI 210 (321)
Q Consensus 156 ~~v~iWD~~~~~~~~~~~~~~~v~~v~~~-----~~~~~~~~~-~~I~iwd~~~~~~~~~l 210 (321)
..+..||+.+..-+.--+.+.-|.++.+. +..++++.+ ..|.-||....+...++
T Consensus 73 t~llaYDV~~N~d~Fyke~~DGvn~i~~g~~~~~~~~l~ivGGncsi~Gfd~~G~e~fWtV 133 (136)
T PF14781_consen 73 TSLLAYDVENNSDLFYKEVPDGVNAIVIGKLGDIPSPLVIVGGNCSIQGFDYEGNEIFWTV 133 (136)
T ss_pred ceEEEEEcccCchhhhhhCccceeEEEEEecCCCCCcEEEECceEEEEEeCCCCcEEEEEe
Confidence 78999999887765544455556666553 233444443 47777777766665554
No 407
>COG3386 Gluconolactonase [Carbohydrate transport and metabolism]
Probab=88.73 E-value=18 Score=32.74 Aligned_cols=194 Identities=16% Similarity=0.059 Sum_probs=99.1
Q ss_pred EEcCCCCEEEEEc-CCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEE
Q 020784 92 SFNQDHGCFAAGT-DHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCI 169 (321)
Q Consensus 92 ~fs~dg~~lasg~-~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~ 169 (321)
.|.+++..|.-.. .++ +.-|+..+++.. .... .+.+......-....++.+. ..+.++|.+++..+
T Consensus 31 ~w~~~~~~L~w~DI~~~~i~r~~~~~g~~~-~~~~--p~~~~~~~~~d~~g~Lv~~~---------~g~~~~~~~~~~~~ 98 (307)
T COG3386 31 VWDPDRGALLWVDILGGRIHRLDPETGKKR-VFPS--PGGFSSGALIDAGGRLIACE---------HGVRLLDPDTGGKI 98 (307)
T ss_pred cCcCCCCEEEEEeCCCCeEEEecCCcCceE-EEEC--CCCcccceeecCCCeEEEEc---------cccEEEeccCCcee
Confidence 4556666444333 333 455655544332 2221 33344433333333444433 56788887666553
Q ss_pred EEEeeC------CceeEEEEeCCe-EEEEECC-----------EEEEEEcC-CcEEEEEEeccCCCCceEEEeeCCCceE
Q 020784 170 GELSFR------SEVRSVKLRRDR-IIVVLEQ-----------KIFVYNFA-DLKLLHQIETIANPKGLCAVSQGVGSLV 230 (321)
Q Consensus 170 ~~~~~~------~~v~~v~~~~~~-~~~~~~~-----------~I~iwd~~-~~~~~~~l~~~~~~~~~~~~s~~~d~~~ 230 (321)
..+... .....+.+.++. +.+.+-. .-.+|-+. .+..++-+..+-..-.-+++++++ ..
T Consensus 99 t~~~~~~~~~~~~r~ND~~v~pdG~~wfgt~~~~~~~~~~~~~~G~lyr~~p~g~~~~l~~~~~~~~NGla~SpDg--~t 176 (307)
T COG3386 99 TLLAEPEDGLPLNRPNDGVVDPDGRIWFGDMGYFDLGKSEERPTGSLYRVDPDGGVVRLLDDDLTIPNGLAFSPDG--KT 176 (307)
T ss_pred EEeccccCCCCcCCCCceeEcCCCCEEEeCCCccccCccccCCcceEEEEcCCCCEEEeecCcEEecCceEECCCC--CE
Confidence 322111 112234444443 2222111 12344443 444444444322223345666654 44
Q ss_pred EEeecCCCCcEEEEeeCC--c-----c-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCC
Q 020784 231 LVCPGLQKGQVRVEHYAS--K-----R-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCP 300 (321)
Q Consensus 231 la~sGs~dg~V~i~d~~~--~-----~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g 300 (321)
+.++-+..+.|.-+++.. . . ...+..+.+..-.++...+|.+.+++-.+|..|.+|+-. |+++.+++.-
T Consensus 177 ly~aDT~~~~i~r~~~d~~~g~~~~~~~~~~~~~~~G~PDG~~vDadG~lw~~a~~~g~~v~~~~pd-G~l~~~i~lP 253 (307)
T COG3386 177 LYVADTPANRIHRYDLDPATGPIGGRRGFVDFDEEPGLPDGMAVDADGNLWVAAVWGGGRVVRFNPD-GKLLGEIKLP 253 (307)
T ss_pred EEEEeCCCCeEEEEecCcccCccCCcceEEEccCCCCCCCceEEeCCCCEEEecccCCceEEEECCC-CcEEEEEECC
Confidence 443356556666654431 1 1 123334567788899999999987666665339999988 9999888755
No 408
>PF10168 Nup88: Nuclear pore component; InterPro: IPR019321 Nup88 can be divided into two structural domains; the N-terminal two-thirds of the protein have no obvious structural motifs. It is, however, where it binds to Nup98; one of the components of the nuclear pore. The C-terminal end is a predicted coiled-coil domain []. Nup88 is over expressed in tumour cells [].
Probab=88.00 E-value=13 Score=37.83 Aligned_cols=35 Identities=14% Similarity=0.161 Sum_probs=28.6
Q ss_pred cccceeEEEECCC---CCEEEEEeCCCcEEEEEEcCCCc
Q 020784 257 HDSRIACFALTQD---GQLLATSSTKGTLVRIFNTLDGT 292 (321)
Q Consensus 257 H~~~V~~vafspd---g~~las~S~Dgt~IrIWd~~tg~ 292 (321)
+...|..+.|+|. +.+|+.-..|++ +|+||+...+
T Consensus 145 ~~~~i~qv~WhP~s~~~~~l~vLtsdn~-lR~y~~~~~~ 182 (717)
T PF10168_consen 145 SSLEIKQVRWHPWSESDSHLVVLTSDNT-LRLYDISDPQ 182 (717)
T ss_pred CCceEEEEEEcCCCCCCCeEEEEecCCE-EEEEecCCCC
Confidence 4557999999987 477888888999 9999998643
No 409
>PF06977 SdiA-regulated: SdiA-regulated; InterPro: IPR009722 This entry represents a conserved region approximately 100 residues long within a number of hypothetical bacterial proteins that may be regulated by SdiA, a member of the LuxR family of transcriptional regulators []. Some proteins contain the IPR001258 from INTERPRO repeat.; PDB: 3QQZ_A.
Probab=87.53 E-value=19 Score=31.54 Aligned_cols=175 Identities=9% Similarity=0.078 Sum_probs=89.3
Q ss_pred CceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCC--ceeEEEEeCC-eEEEEE--CCEEEEEEcC
Q 020784 128 GGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRS--EVRSVKLRRD-RIIVVL--EQKIFVYNFA 202 (321)
Q Consensus 128 ~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~--~v~~v~~~~~-~~~~~~--~~~I~iwd~~ 202 (321)
..+..+.+.++.+.++++.+. ++.|...|. +|+.+..+.+.+ ..-.|++..+ .+++.. .+.+.++++.
T Consensus 22 ~e~SGLTy~pd~~tLfaV~d~------~~~i~els~-~G~vlr~i~l~g~~D~EgI~y~g~~~~vl~~Er~~~L~~~~~~ 94 (248)
T PF06977_consen 22 DELSGLTYNPDTGTLFAVQDE------PGEIYELSL-DGKVLRRIPLDGFGDYEGITYLGNGRYVLSEERDQRLYIFTID 94 (248)
T ss_dssp S-EEEEEEETTTTEEEEEETT------TTEEEEEET-T--EEEEEE-SS-SSEEEEEE-STTEEEEEETTTTEEEEEEE-
T ss_pred CCccccEEcCCCCeEEEEECC------CCEEEEEcC-CCCEEEEEeCCCCCCceeEEEECCCEEEEEEcCCCcEEEEEEe
Confidence 358888999988888777753 577877786 578888877654 5777887664 455555 3588888872
Q ss_pred C------cEEEEEEec--c-CCCCc--eEEEeeCCCceEEEeecCCCCcEEEEeeCC----cceE--Ee------ecccc
Q 020784 203 D------LKLLHQIET--I-ANPKG--LCAVSQGVGSLVLVCPGLQKGQVRVEHYAS----KRTK--FI------MAHDS 259 (321)
Q Consensus 203 ~------~~~~~~l~~--~-~~~~~--~~~~s~~~d~~~la~sGs~dg~V~i~d~~~----~~~~--~l------~~H~~ 259 (321)
. ....+++.. . ....+ -+++.+.. +.++++ ....-..|+.+.. ..+. .. ..+..
T Consensus 95 ~~~~~~~~~~~~~~~l~~~~~~N~G~EGla~D~~~-~~L~v~--kE~~P~~l~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 171 (248)
T PF06977_consen 95 DDTTSLDRADVQKISLGFPNKGNKGFEGLAYDPKT-NRLFVA--KERKPKRLYEVNGFPGGFDLFVSDDQDLDDDKLFVR 171 (248)
T ss_dssp ---TT--EEEEEEEE---S---SS--EEEEEETTT-TEEEEE--EESSSEEEEEEESTT-SS--EEEE-HHHH-HT--SS
T ss_pred ccccccchhhceEEecccccCCCcceEEEEEcCCC-CEEEEE--eCCCChhhEEEccccCccceeeccccccccccceec
Confidence 2 111233332 1 11122 34444433 344442 4455555544432 1121 11 22445
Q ss_pred ceeEEEECCC-CCEEEEEeCCCcEEEEEEcCCCcEEEEEe--CCC--------cceeEEEeecCce
Q 020784 260 RIACFALTQD-GQLLATSSTKGTLVRIFNTLDGTLLQEEC--CPS--------ISAQSGLWLSSAW 314 (321)
Q Consensus 260 ~V~~vafspd-g~~las~S~Dgt~IrIWd~~tg~~i~~~~--~g~--------~~~~~~~s~d~~~ 314 (321)
.+.+++|+|. |.+++-..+... |-++| .+|+.+..+. .|. +.-.+++..+|..
T Consensus 172 d~S~l~~~p~t~~lliLS~es~~-l~~~d-~~G~~~~~~~L~~g~~gl~~~~~QpEGIa~d~~G~L 235 (248)
T PF06977_consen 172 DLSGLSYDPRTGHLLILSDESRL-LLELD-RQGRVVSSLSLDRGFHGLSKDIPQPEGIAFDPDGNL 235 (248)
T ss_dssp ---EEEEETTTTEEEEEETTTTE-EEEE--TT--EEEEEE-STTGGG-SS---SEEEEEE-TT--E
T ss_pred cccceEEcCCCCeEEEEECCCCe-EEEEC-CCCCEEEEEEeCCcccCcccccCCccEEEECCCCCE
Confidence 6899999987 455665555555 88999 7888776553 332 2334577777744
No 410
>PF15390 DUF4613: Domain of unknown function (DUF4613)
Probab=87.18 E-value=32 Score=33.82 Aligned_cols=96 Identities=15% Similarity=0.107 Sum_probs=61.9
Q ss_pred EEEEcCCCCEEEEEcCCcE-EEEEec--CCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCC
Q 020784 90 HISFNQDHGCFAAGTDHGF-RIYNCD--PFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQS 166 (321)
Q Consensus 90 ~v~fs~dg~~lasg~~~gv-~vw~~~--~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~ 166 (321)
.|-|+|....|+.=..+.+ .++++. ..+...... ..|.|-+.+|..+++.++++-|+. =.-.|||-...
T Consensus 117 GCVWHPk~~iL~VLT~~dvSV~~sV~~d~srVkaDi~--~~G~IhCACWT~DG~RLVVAvGSs------LHSyiWd~~qK 188 (671)
T PF15390_consen 117 GCVWHPKKAILTVLTARDVSVLPSVHCDSSRVKADIK--TSGLIHCACWTKDGQRLVVAVGSS------LHSYIWDSAQK 188 (671)
T ss_pred cccccCCCceEEEEecCceeEeeeeeeCCceEEEecc--CCceEEEEEecCcCCEEEEEeCCe------EEEEEecCchh
Confidence 4779999998887666444 466653 333333333 367888999999999888887652 35789996544
Q ss_pred cEE-----EEEeeCCceeEEEEeCC-eEEEEEC
Q 020784 167 RCI-----GELSFRSEVRSVKLRRD-RIIVVLE 193 (321)
Q Consensus 167 ~~~-----~~~~~~~~v~~v~~~~~-~~~~~~~ 193 (321)
... ..|+..+.|.++.-.-+ .++++++
T Consensus 189 tL~~CsfcPVFdv~~~Icsi~AT~dsqVAvaTE 221 (671)
T PF15390_consen 189 TLHRCSFCPVFDVGGYICSIEATVDSQVAVATE 221 (671)
T ss_pred hhhhCCcceeecCCCceEEEEEeccceEEEEec
Confidence 321 23455667777665443 5666664
No 411
>PF10214 Rrn6: RNA polymerase I-specific transcription-initiation factor; InterPro: IPR019350 RNA polymerase I-specific transcription-initiation factor Rrn6 and Rrn7 represent components of a multisubunit transcription factor essential for the initiation of rDNA transcription by Pol I []. These proteins are found in fungi.
Probab=87.01 E-value=40 Score=34.76 Aligned_cols=112 Identities=16% Similarity=0.162 Sum_probs=68.1
Q ss_pred CCCCeEEEEEcCC-CCEEEEEcCCc-EEEEEecCCc----eeEEeeeecCCce----------EEEEEecCCCeEEEEeC
Q 020784 84 PPPTLLHISFNQD-HGCFAAGTDHG-FRIYNCDPFR----EIFRRDFERGGGI----------GVVEMLFRCNILALVGG 147 (321)
Q Consensus 84 ~~~~V~~v~fs~d-g~~lasg~~~g-v~vw~~~~~~----~~~~~~~~~~~~v----------~~v~~~~~~~~~~~~sg 147 (321)
...+...|+|+|. .+.||.-..+| .-||++.... ..........|.+ ..++|..+.+.++++.
T Consensus 144 gg~~~aDv~FnP~~~~q~AiVD~~G~Wsvw~i~~~~~~~~~~~~~~~~~~gsi~~d~~e~s~w~rI~W~~~~~~lLv~~- 222 (765)
T PF10214_consen 144 GGFPHADVAFNPWDQRQFAIVDEKGNWSVWDIKGRPKRKSSNLRLSRNISGSIIFDPEELSNWKRILWVSDSNRLLVCN- 222 (765)
T ss_pred CCCccceEEeccCccceEEEEeccCcEEEEEeccccccCCcceeeccCCCccccCCCcccCcceeeEecCCCCEEEEEc-
Confidence 4457788999984 46788888877 5599992111 1111110011222 2445555555555554
Q ss_pred CCCCCCCCCcEEEEeCCCCcEEE---EEeeCCceeEEEEeCC---eEEEEECCEEEEEEcCC
Q 020784 148 GPDPQYPLNKVMIWDDHQSRCIG---ELSFRSEVRSVKLRRD---RIIVVLEQKIFVYNFAD 203 (321)
Q Consensus 148 ~~~~~~~d~~v~iWD~~~~~~~~---~~~~~~~v~~v~~~~~---~~~~~~~~~I~iwd~~~ 203 (321)
...+.++|+++..... .......|..+.-.+. .+++.+...|...++..
T Consensus 223 -------r~~l~~~d~~~~~~~~~l~~~~~~~~IlDv~~~~~~~~~~FiLTs~eiiw~~~~~ 277 (765)
T PF10214_consen 223 -------RSKLMLIDFESNWQTEYLVTAKTWSWILDVKRSPDNPSHVFILTSKEIIWLDVKS 277 (765)
T ss_pred -------CCceEEEECCCCCccchhccCCChhheeeEEecCCccceEEEEecCeEEEEEccC
Confidence 4678888888765422 2222245777776655 78888999999999865
No 412
>PF12355 Dscam_C: Down syndrome cell adhesion molecule C terminal ; InterPro: IPR021012 This entry is specific to the insecta, predominantly Drosophila spp. This entry is found in association with PF00047 from PFAM, PF07679 from PFAM and PF00041 from PFAM. The Down syndrome cell adhesion molecule (Dscam) belongs to a family of cell membrane molecules involved in the differentiation of the nervous system. This is the C-terminal cytoplasmic tail region of Dscam. In Drosophila melanogaster (Fruit fly) the gene has at least 59 different transcripts. Dscam may play a role in the nervous and immune systems [].
Probab=86.98 E-value=0.42 Score=35.30 Aligned_cols=11 Identities=55% Similarity=1.038 Sum_probs=7.1
Q ss_pred CCCCCCCCCCC
Q 020784 12 PEPTPDPNPNP 22 (321)
Q Consensus 12 ~~~~~~~~~~~ 22 (321)
||||||||-|-
T Consensus 63 PePPpPPPRn~ 73 (124)
T PF12355_consen 63 PEPPPPPPRNH 73 (124)
T ss_pred CCCCCcCCCCC
Confidence 67777666554
No 413
>PHA02790 Kelch-like protein; Provisional
Probab=86.69 E-value=32 Score=33.27 Aligned_cols=140 Identities=16% Similarity=0.114 Sum_probs=65.3
Q ss_pred CCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCc--eeEEEEeCCeEEEEEC-----CEEEEEEcCCcEEEEEEe
Q 020784 139 CNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSE--VRSVKLRRDRIIVVLE-----QKIFVYNFADLKLLHQIE 211 (321)
Q Consensus 139 ~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~--v~~v~~~~~~~~~~~~-----~~I~iwd~~~~~~~~~l~ 211 (321)
++.+.++||.+ ....+..||..+++....-..... -.++....+.+++.++ ..+..||..+.+ .....
T Consensus 318 ~~~iYviGG~~----~~~sve~ydp~~n~W~~~~~l~~~r~~~~~~~~~g~IYviGG~~~~~~~ve~ydp~~~~-W~~~~ 392 (480)
T PHA02790 318 NNKLYVVGGLP----NPTSVERWFHGDAAWVNMPSLLKPRCNPAVASINNVIYVIGGHSETDTTTEYLLPNHDQ-WQFGP 392 (480)
T ss_pred CCEEEEECCcC----CCCceEEEECCCCeEEECCCCCCCCcccEEEEECCEEEEecCcCCCCccEEEEeCCCCE-EEeCC
Confidence 34555555542 125688899877665432222211 1233344555555532 357788876542 12211
Q ss_pred ccCCCC-ceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEE---eeccccceeEEEECCCCCEEEEEeCCCc----EE
Q 020784 212 TIANPK-GLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKF---IMAHDSRIACFALTQDGQLLATSSTKGT----LV 283 (321)
Q Consensus 212 ~~~~~~-~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~---l~~H~~~V~~vafspdg~~las~S~Dgt----~I 283 (321)
....+. ..++...+ +.+.++ | |.+.++|..+..=.. +.........+.+ +|++.+.|+.++. .|
T Consensus 393 ~m~~~r~~~~~~~~~--~~IYv~-G---G~~e~ydp~~~~W~~~~~m~~~r~~~~~~v~--~~~IYviGG~~~~~~~~~v 464 (480)
T PHA02790 393 STYYPHYKSCALVFG--RRLFLV-G---RNAEFYCESSNTWTLIDDPIYPRDNPELIIV--DNKLLLIGGFYRGSYIDTI 464 (480)
T ss_pred CCCCccccceEEEEC--CEEEEE-C---CceEEecCCCCcEeEcCCCCCCccccEEEEE--CCEEEEECCcCCCcccceE
Confidence 111111 12233333 366664 5 356677765543111 2111222222333 6778888876532 15
Q ss_pred EEEEcCCC
Q 020784 284 RIFNTLDG 291 (321)
Q Consensus 284 rIWd~~tg 291 (321)
.+||..++
T Consensus 465 e~Yd~~~~ 472 (480)
T PHA02790 465 EVYNNRTY 472 (480)
T ss_pred EEEECCCC
Confidence 55555543
No 414
>PF07569 Hira: TUP1-like enhancer of split; InterPro: IPR011494 The Hira proteins are found in a range of eukaryotes and are implicated in the assembly of repressive chromatin. These proteins also contain IPR001680 from INTERPRO.; GO: 0006355 regulation of transcription, DNA-dependent, 0005634 nucleus
Probab=85.46 E-value=7.7 Score=33.25 Aligned_cols=67 Identities=18% Similarity=0.203 Sum_probs=46.4
Q ss_pred EEEeeCCCceEEEeecCCCCcEEEEeeCCcceE--------Eee-------ccccceeEEEECCCCCEEEEEeCCCcEEE
Q 020784 220 CAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTK--------FIM-------AHDSRIACFALTQDGQLLATSSTKGTLVR 284 (321)
Q Consensus 220 ~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~--------~l~-------~H~~~V~~vafspdg~~las~S~Dgt~Ir 284 (321)
+.+...+ +.++|+ +.+|.+++||+..+... .+. .....|..+.++.+|.-+++-+ +|. ..
T Consensus 16 ~~l~~~~-~~Ll~i--T~~G~l~vWnl~~~k~~~~~~Si~pll~~~~~~~~~~~~~i~~~~lt~~G~PiV~ls-ng~-~y 90 (219)
T PF07569_consen 16 SFLECNG-SYLLAI--TSSGLLYVWNLKKGKAVLPPVSIAPLLNSSPVSDKSSSPNITSCSLTSNGVPIVTLS-NGD-SY 90 (219)
T ss_pred EEEEeCC-CEEEEE--eCCCeEEEEECCCCeeccCCccHHHHhcccccccCCCCCcEEEEEEcCCCCEEEEEe-CCC-EE
Confidence 3344433 235554 88899999999865432 122 3556799999999999999887 577 78
Q ss_pred EEEcCCC
Q 020784 285 IFNTLDG 291 (321)
Q Consensus 285 IWd~~tg 291 (321)
.|+..-+
T Consensus 91 ~y~~~L~ 97 (219)
T PF07569_consen 91 SYSPDLG 97 (219)
T ss_pred Eeccccc
Confidence 9986543
No 415
>COG3490 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=85.35 E-value=18 Score=32.25 Aligned_cols=109 Identities=10% Similarity=0.053 Sum_probs=65.8
Q ss_pred CcEEEEEeeCCceeEEEEeCCe---EEEEE--CCEEEEEEcCCcEEEEEEeccCC--CCceEEEeeCCCceEEEeec---
Q 020784 166 SRCIGELSFRSEVRSVKLRRDR---IIVVL--EQKIFVYNFADLKLLHQIETIAN--PKGLCAVSQGVGSLVLVCPG--- 235 (321)
Q Consensus 166 ~~~~~~~~~~~~v~~v~~~~~~---~~~~~--~~~I~iwd~~~~~~~~~l~~~~~--~~~~~~~s~~~d~~~la~sG--- 235 (321)
|+++........-..+.+++-. ++.+- .....++|..+.+...++....+ -.+--.|++ |+.+|..+-
T Consensus 58 Gk~v~~~~lpaR~Hgi~~~p~~~ravafARrPGtf~~vfD~~~~~~pv~~~s~~~RHfyGHGvfs~--dG~~LYATEndf 135 (366)
T COG3490 58 GKIVFATALPARGHGIAFHPALPRAVAFARRPGTFAMVFDPNGAQEPVTLVSQEGRHFYGHGVFSP--DGRLLYATENDF 135 (366)
T ss_pred CceeeeeecccccCCeecCCCCcceEEEEecCCceEEEECCCCCcCcEEEecccCceeecccccCC--CCcEEEeecCCC
Confidence 4555444444433445555432 22222 23677888887777776654322 122234454 456665432
Q ss_pred -CCCCcEEEEeeCCcc--eEEeeccccceeEEEECCCCCEEEEE
Q 020784 236 -LQKGQVRVEHYASKR--TKFIMAHDSRIACFALTQDGQLLATS 276 (321)
Q Consensus 236 -s~dg~V~i~d~~~~~--~~~l~~H~~~V~~vafspdg~~las~ 276 (321)
...|.|-|||...+- +-.+..|.-....+.+.+||++|+.+
T Consensus 136 d~~rGViGvYd~r~~fqrvgE~~t~GiGpHev~lm~DGrtlvva 179 (366)
T COG3490 136 DPNRGVIGVYDAREGFQRVGEFSTHGIGPHEVTLMADGRTLVVA 179 (366)
T ss_pred CCCCceEEEEecccccceecccccCCcCcceeEEecCCcEEEEe
Confidence 124678889887443 44788898889999999999999876
No 416
>KOG2444 consensus WD40 repeat protein [General function prediction only]
Probab=85.24 E-value=5.1 Score=34.29 Aligned_cols=82 Identities=16% Similarity=0.169 Sum_probs=50.0
Q ss_pred cCCCCcEEEEeeCCcceE--EeeccccceeE-EEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCc---ceeEEE
Q 020784 235 GLQKGQVRVEHYASKRTK--FIMAHDSRIAC-FALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSI---SAQSGL 308 (321)
Q Consensus 235 Gs~dg~V~i~d~~~~~~~--~l~~H~~~V~~-vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~---~~~~~~ 308 (321)
|..+|.|.+|..+..-.+ ....-...|.+ |.--.++.+..+++.||. ||-|++.-++.+.-. ..|. ..-...
T Consensus 76 G~~dg~v~~~n~n~~g~~~d~~~s~~e~i~~~Ip~~~~~~~~c~~~~dg~-ir~~n~~p~k~~g~~-g~h~~~~~e~~iv 153 (238)
T KOG2444|consen 76 GTSDGAVYVFNWNLEGAHSDRVCSGEESIDLGIPNGRDSSLGCVGAQDGR-IRACNIKPNKVLGYV-GQHNFESGEELIV 153 (238)
T ss_pred ecccceEEEecCCccchHHHhhhcccccceeccccccccceeEEeccCCc-eeeeccccCceeeee-ccccCCCcceeEE
Confidence 999999999776521111 11111222222 333345668889999999 999999998876533 2222 122355
Q ss_pred eecCceEEEe
Q 020784 309 WLSSAWLRVL 318 (321)
Q Consensus 309 s~d~~~la~~ 318 (321)
+.++++|+.+
T Consensus 154 v~sd~~i~~a 163 (238)
T KOG2444|consen 154 VGSDEFLKIA 163 (238)
T ss_pred ecCCceEEee
Confidence 6777887776
No 417
>PHA02713 hypothetical protein; Provisional
Probab=85.17 E-value=11 Score=37.16 Aligned_cols=90 Identities=18% Similarity=0.169 Sum_probs=45.3
Q ss_pred CcEEEEeCCCCcEEEEEee--CCceeEEEEeCCeEEEEEC--------CEEEEEEcCC---cEEEEEEeccCCCCceEEE
Q 020784 156 NKVMIWDDHQSRCIGELSF--RSEVRSVKLRRDRIIVVLE--------QKIFVYNFAD---LKLLHQIETIANPKGLCAV 222 (321)
Q Consensus 156 ~~v~iWD~~~~~~~~~~~~--~~~v~~v~~~~~~~~~~~~--------~~I~iwd~~~---~~~~~~l~~~~~~~~~~~~ 222 (321)
+++..||.++.+....-.. ...-.++....+.+++.++ ..+..||..+ ...+..+.......+ ..
T Consensus 432 ~~ve~YDP~td~W~~v~~m~~~r~~~~~~~~~~~IYv~GG~~~~~~~~~~ve~Ydp~~~~~W~~~~~m~~~r~~~~--~~ 509 (557)
T PHA02713 432 NKVIRYDTVNNIWETLPNFWTGTIRPGVVSHKDDIYVVCDIKDEKNVKTCIFRYNTNTYNGWELITTTESRLSALH--TI 509 (557)
T ss_pred ceEEEECCCCCeEeecCCCCcccccCcEEEECCEEEEEeCCCCCCccceeEEEecCCCCCCeeEccccCcccccce--eE
Confidence 4688899888765432211 1112234445556666542 2467888875 333333322211112 22
Q ss_pred eeCCCceEEEeecCCCC--cEEEEeeCCcc
Q 020784 223 SQGVGSLVLVCPGLQKG--QVRVEHYASKR 250 (321)
Q Consensus 223 s~~~d~~~la~sGs~dg--~V~i~d~~~~~ 250 (321)
.. ++.+.++ |+.+| .|..+|..+.+
T Consensus 510 ~~--~~~iyv~-Gg~~~~~~~e~yd~~~~~ 536 (557)
T PHA02713 510 LH--DNTIMML-HCYESYMLQDTFNVYTYE 536 (557)
T ss_pred EE--CCEEEEE-eeecceeehhhcCccccc
Confidence 22 3366664 87777 45556665544
No 418
>PF14655 RAB3GAP2_N: Rab3 GTPase-activating protein regulatory subunit N-terminus
Probab=84.28 E-value=13 Score=35.18 Aligned_cols=39 Identities=8% Similarity=-0.106 Sum_probs=30.0
Q ss_pred CCCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeEEee
Q 020784 85 PPTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRD 123 (321)
Q Consensus 85 ~~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~ 123 (321)
+..+.+|+.+|++++.|+...-| |.|+|+.++..+..++
T Consensus 307 ~R~~~~i~~sP~~~laA~tDslGRV~LiD~~~~~vvrmWK 346 (415)
T PF14655_consen 307 KREGESICLSPSGRLAAVTDSLGRVLLIDVARGIVVRMWK 346 (415)
T ss_pred CceEEEEEECCCCCEEEEEcCCCcEEEEECCCChhhhhhc
Confidence 34799999999999888765544 7899998887665554
No 419
>TIGR02604 Piru_Ver_Nterm putative membrane-bound dehydrogenase domain. All proteins that score above the trusted cutoff score of 45 to this model are large proteins of either Pirellula sp. 1 or Verrucomicrobium spinosum. These proteins all contain, in addition to this domain, several hundred residues of highly variable sequence, and then a well-conserved C-terminal domain (TIGR02603) that features a putative cytochrome c-type heme binding motif CXXCH. The membrane-bound L-sorbosone dehydrogenase from Acetobacter liquefaciens (Gluconacetobacter liquefaciens) is homologous to this domain but lacks additional sequence regions shared by members of this family and belongs to a different clade of the larger family of homologs. It and its closely related homologs are excluded from the this model by scoring between the trusted (45) and noise (18) cutoffs.
Probab=83.92 E-value=36 Score=31.52 Aligned_cols=111 Identities=11% Similarity=0.081 Sum_probs=56.9
Q ss_pred ceeEEEEeCCeEEEEECCEEEEE-EcCC-c----E---EEEEEeccC--CCCceEEEeeCCCceEEEeecCCC-------
Q 020784 177 EVRSVKLRRDRIIVVLEQKIFVY-NFAD-L----K---LLHQIETIA--NPKGLCAVSQGVGSLVLVCPGLQK------- 238 (321)
Q Consensus 177 ~v~~v~~~~~~~~~~~~~~I~iw-d~~~-~----~---~~~~l~~~~--~~~~~~~~s~~~d~~~la~sGs~d------- 238 (321)
.+..+++.++.++++....|..| |... + + ++..+.... .......+...+|+.+.+..|+..
T Consensus 73 ~p~Gi~~~~~GlyV~~~~~i~~~~d~~gdg~ad~~~~~l~~~~~~~~~~~~~~~~~l~~gpDG~LYv~~G~~~~~~~~~~ 152 (367)
T TIGR02604 73 MVTGLAVAVGGVYVATPPDILFLRDKDGDDKADGEREVLLSGFGGQINNHHHSLNSLAWGPDGWLYFNHGNTLASKVTRP 152 (367)
T ss_pred CccceeEecCCEEEeCCCeEEEEeCCCCCCCCCCccEEEEEccCCCCCcccccccCceECCCCCEEEecccCCCceeccC
Confidence 46788888777777766666655 4421 1 1 112222210 012233445556666665445321
Q ss_pred -----------CcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEE
Q 020784 239 -----------GQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 239 -----------g~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd 287 (321)
|.|.-++..+.....+..--.....++|+++|.++++-..++...+|-.
T Consensus 153 ~~~~~~~~~~~g~i~r~~pdg~~~e~~a~G~rnp~Gl~~d~~G~l~~tdn~~~~~~~i~~ 212 (367)
T TIGR02604 153 GTSDESRQGLGGGLFRYNPDGGKLRVVAHGFQNPYGHSVDSWGDVFFCDNDDPPLCRVTP 212 (367)
T ss_pred CCccCcccccCceEEEEecCCCeEEEEecCcCCCccceECCCCCEEEEccCCCceeEEcc
Confidence 2222233333333333322345679999999999887654444344433
No 420
>PF03088 Str_synth: Strictosidine synthase; InterPro: IPR018119 This entry represents a conserved region found in strictosidine synthase (4.3.3.2 from EC), a key enzyme in alkaloid biosynthesis. It catalyses the Pictet-Spengler stereospecific condensation of tryptamine with secologanin to form strictosidine []. The structure of the native enzyme from the Indian medicinal plant Rauvolfia serpentina (Serpentwood) (Devilpepper) represents the first example of a six-bladed four-stranded beta-propeller fold from the plant kingdom [].; GO: 0016844 strictosidine synthase activity, 0009058 biosynthetic process; PDB: 2FPB_A 2V91_B 2FP8_A 3V1S_B 2FPC_A 2VAQ_A 2FP9_B.
Probab=83.43 E-value=5.3 Score=28.94 Aligned_cols=53 Identities=15% Similarity=0.188 Sum_probs=34.5
Q ss_pred ecCCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEE-eCCCcEEEEE
Q 020784 234 PGLQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATS-STKGTLVRIF 286 (321)
Q Consensus 234 sGs~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~-S~Dgt~IrIW 286 (321)
.+..+|.+.-||..+++..++..--.-.+.|++++|+..|+.+ ..-..+.|.|
T Consensus 32 e~~~~GRll~ydp~t~~~~vl~~~L~fpNGVals~d~~~vlv~Et~~~Ri~ryw 85 (89)
T PF03088_consen 32 EGRPTGRLLRYDPSTKETTVLLDGLYFPNGVALSPDESFVLVAETGRYRILRYW 85 (89)
T ss_dssp HT---EEEEEEETTTTEEEEEEEEESSEEEEEE-TTSSEEEEEEGGGTEEEEEE
T ss_pred cCCCCcCEEEEECCCCeEEEehhCCCccCeEEEcCCCCEEEEEeccCceEEEEE
Confidence 3667788888999988877666555678999999999966544 3333434444
No 421
>PF10313 DUF2415: Uncharacterised protein domain (DUF2415); InterPro: IPR019417 This entry represents a short (30 residues) domain of unknown function found in a family of fungal proteins. It contains a characteristic DLL sequence motif.
Probab=83.15 E-value=4.1 Score=25.10 Aligned_cols=30 Identities=13% Similarity=0.210 Sum_probs=22.4
Q ss_pred CCeEEEEEcCC-C--CEEEEEcCCc-EEEEEecC
Q 020784 86 PTLLHISFNQD-H--GCFAAGTDHG-FRIYNCDP 115 (321)
Q Consensus 86 ~~V~~v~fs~d-g--~~lasg~~~g-v~vw~~~~ 115 (321)
+.|++|.|+|+ + ++|+-.-+.+ |.|+|+.+
T Consensus 1 GAvR~~kFsP~~~~~DLL~~~E~~g~vhi~D~R~ 34 (43)
T PF10313_consen 1 GAVRCCKFSPEPGGNDLLAWAEHQGRVHIVDTRS 34 (43)
T ss_pred CCeEEEEeCCCCCcccEEEEEccCCeEEEEEccc
Confidence 36899999974 4 5777766655 77999874
No 422
>COG5276 Uncharacterized conserved protein [Function unknown]
Probab=83.06 E-value=35 Score=30.68 Aligned_cols=141 Identities=11% Similarity=0.044 Sum_probs=78.2
Q ss_pred EEEEEeeCCceeEEEEeCCeEEEEEC-CEEEEEEcCCcE---EEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEE
Q 020784 168 CIGELSFRSEVRSVKLRRDRIIVVLE-QKIFVYNFADLK---LLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRV 243 (321)
Q Consensus 168 ~~~~~~~~~~v~~v~~~~~~~~~~~~-~~I~iwd~~~~~---~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i 243 (321)
.+..+....-+..+.+..+...++-. ..++|.|+.+.. ++..+... ...-.+...++..+++ .-.||-+.
T Consensus 79 l~~~i~~~~l~~Dv~vse~yvyvad~ssGL~IvDIS~P~sP~~~~~lnt~---gyaygv~vsGn~aYVa--dlddgfLi- 152 (370)
T COG5276 79 LLSVINARDLFADVRVSEEYVYVADWSSGLRIVDISTPDSPTLIGFLNTD---GYAYGVYVSGNYAYVA--DLDDGFLI- 152 (370)
T ss_pred eEEEEehhhhhheeEecccEEEEEcCCCceEEEeccCCCCcceeccccCC---ceEEEEEecCCEEEEe--eccCcEEE-
Confidence 34445556667788899998888854 589999996533 22222221 2233344445444443 33555544
Q ss_pred EeeCCc--c-eE-EeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCC---cEEEEEeCCCcceeEEEeecCceEE
Q 020784 244 EHYASK--R-TK-FIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDG---TLLQEECCPSISAQSGLWLSSAWLR 316 (321)
Q Consensus 244 ~d~~~~--~-~~-~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg---~~i~~~~~g~~~~~~~~s~d~~~la 316 (321)
.|+.+. + +. .+..-...-..++.|-+..+. +.+|+. ++|-|+..- +++..++.+-.......+.+-.|++
T Consensus 153 vdvsdpssP~lagrya~~~~d~~~v~ISGn~AYv--A~~d~G-L~ivDVSnp~sPvli~~~n~g~g~~sv~vsdnr~y~v 229 (370)
T COG5276 153 VDVSDPSSPQLAGRYALPGGDTHDVAISGNYAYV--AWRDGG-LTIVDVSNPHSPVLIGSYNTGPGTYSVSVSDNRAYLV 229 (370)
T ss_pred EECCCCCCceeeeeeccCCCCceeEEEecCeEEE--EEeCCC-eEEEEccCCCCCeEEEEEecCCceEEEEecCCeeEEE
Confidence 444432 2 22 333334445778888554443 457888 889999764 4566665543322333344445554
Q ss_pred E
Q 020784 317 V 317 (321)
Q Consensus 317 ~ 317 (321)
+
T Consensus 230 v 230 (370)
T COG5276 230 V 230 (370)
T ss_pred E
Confidence 4
No 423
>KOG1896 consensus mRNA cleavage and polyadenylation factor II complex, subunit CFT1 (CPSF subunit) [RNA processing and modification]
Probab=83.03 E-value=23 Score=37.60 Aligned_cols=130 Identities=15% Similarity=0.203 Sum_probs=79.0
Q ss_pred CCcEEEEeCCC-----C-----cEEEEE---eeCCceeEEEEeCCeEEEEECCEEEEEEc-CCcEEEEEEeccCCCCceE
Q 020784 155 LNKVMIWDDHQ-----S-----RCIGEL---SFRSEVRSVKLRRDRIIVVLEQKIFVYNF-ADLKLLHQIETIANPKGLC 220 (321)
Q Consensus 155 d~~v~iWD~~~-----~-----~~~~~~---~~~~~v~~v~~~~~~~~~~~~~~I~iwd~-~~~~~~~~l~~~~~~~~~~ 220 (321)
.|.+.|+|+.. | ..+.++ +..++|..+|=-..+++++.+.+|.+|++ +...++- +..-.-+..+.
T Consensus 1064 RGr~hi~diIeVVPepgkP~t~~KlKel~~eE~KGtVsavceV~G~l~~~~GqKI~v~~l~r~~~lig-VaFiD~~~yv~ 1142 (1366)
T KOG1896|consen 1064 RGRIHIFDIIEVVPEPGKPFTKNKLKELYIEEQKGTVSAVCEVRGHLLSSQGQKIIVRKLDRDSELIG-VAFIDLPLYVH 1142 (1366)
T ss_pred cccEEEEEEEEecCCCCCCcccceeeeeehhhcccceEEEEEeccEEEEccCcEEEEEEeccCCccee-eEEeccceeEE
Confidence 48899999532 2 122222 23467888887777888899999999999 4444322 11112223333
Q ss_pred EEeeCCCceEEEeecCCCCcEEEEeeCCcceE-Eeec---cccceeEEEECCCCC--EEEEEeCCCcEEEEEEcC
Q 020784 221 AVSQGVGSLVLVCPGLQKGQVRVEHYASKRTK-FIMA---HDSRIACFALTQDGQ--LLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 221 ~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~-~l~~---H~~~V~~vafspdg~--~las~S~Dgt~IrIWd~~ 289 (321)
.+..- +++|.+ |+.-+.|....++.++.. .+-. -.-.|.++.|--||. +|+.+..|++ |+++-..
T Consensus 1143 s~~~v--knlIl~-gDV~ksisfl~fqeep~rlsL~srd~~~l~v~s~EFLVdg~~L~flvsDa~rN-i~vy~Y~ 1213 (1366)
T KOG1896|consen 1143 SMKVV--KNLILA-GDVMKSISFLGFQEEPYRLSLLSRDFEPLNVYSTEFLVDGSNLSFLVSDADRN-IHVYMYA 1213 (1366)
T ss_pred ehhhh--hhheeh-hhhhhceEEEEEccCceEEEEeecCCchhhceeeeeEEcCCeeEEEEEcCCCc-EEEEEeC
Confidence 33221 134443 787777887555555432 2222 233588888876664 6788888999 9999654
No 424
>KOG2280 consensus Vacuolar assembly/sorting protein VPS16 [Intracellular trafficking, secretion, and vesicular transport]
Probab=82.27 E-value=60 Score=32.88 Aligned_cols=42 Identities=17% Similarity=0.297 Sum_probs=34.4
Q ss_pred ccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCC
Q 020784 258 DSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCP 300 (321)
Q Consensus 258 ~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g 300 (321)
.+.+..+..||++++||---++|. |.+-+....+++-+++.+
T Consensus 216 ~~~~~ki~VS~n~~~laLyt~~G~-i~~vs~D~~~~lce~~~~ 257 (829)
T KOG2280|consen 216 NSSVVKISVSPNRRFLALYTETGK-IWVVSIDLSQILCEFNCT 257 (829)
T ss_pred CceEEEEEEcCCcceEEEEecCCc-EEEEecchhhhhhccCCC
Confidence 467888999999999999999999 888887777776666533
No 425
>PF06433 Me-amine-dh_H: Methylamine dehydrogenase heavy chain (MADH); InterPro: IPR009451 Methylamine dehydrogenase (1.4.99.3 from EC) is a periplasmic quinoprotein found in several methyltrophic bacteria []. It is induced when grown on methylamine as a carbon source MADH and catalyses the oxidative deamination of amines to their corresponding aldehydes. The redox cofactor of this enzyme is tryptophan tryptophylquinone (TTQ). Electrons derived from the oxidation of methylamine are passed to an electron acceptor, which is usually the blue-copper protein amicyanin (IPR002386 from INTERPRO). RCH2NH2 + H2O + acceptor = RCHO + NH3 + reduced acceptor MADH is a hetero-tetramer, comprised of two heavy subunits and two light subunits. The heavy subunit forms a seven-bladed beta-propeller like structure [].; GO: 0030058 amine dehydrogenase activity, 0030416 methylamine metabolic process, 0055114 oxidation-reduction process, 0042597 periplasmic space; PDB: 3RN1_F 3SVW_F 3PXT_F 3L4O_F 3L4M_D 3SJL_F 3PXS_D 3ORV_F 3RMZ_F 3RLM_F ....
Probab=81.93 E-value=42 Score=30.81 Aligned_cols=176 Identities=17% Similarity=0.141 Sum_probs=91.0
Q ss_pred cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCC--CC-CCCCCCcEEEEeCCCCcEEEEEeeCCcee----
Q 020784 107 GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGG--PD-PQYPLNKVMIWDDHQSRCIGELSFRSEVR---- 179 (321)
Q Consensus 107 gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~--~~-~~~~d~~v~iWD~~~~~~~~~~~~~~~v~---- 179 (321)
.+.|+|.++++.+-.... +-...+..+++++.+.+++.= +. ..-...-|.+||.++-....++.......
T Consensus 18 rv~viD~d~~k~lGmi~~---g~~~~~~~spdgk~~y~a~T~~sR~~rG~RtDvv~~~D~~TL~~~~EI~iP~k~R~~~~ 94 (342)
T PF06433_consen 18 RVYVIDADSGKLLGMIDT---GFLGNVALSPDGKTIYVAETFYSRGTRGERTDVVEIWDTQTLSPTGEIEIPPKPRAQVV 94 (342)
T ss_dssp EEEEEETTTTEEEEEEEE---ESSEEEEE-TTSSEEEEEEEEEEETTEEEEEEEEEEEETTTTEEEEEEEETTS-B--BS
T ss_pred eEEEEECCCCcEEEEeec---ccCCceeECCCCCEEEEEEEEEeccccccceeEEEEEecCcCcccceEecCCcchheec
Confidence 356888888776555442 334445667888877765410 00 00011349999999999888887654211
Q ss_pred ----EEEEe--CCeEEEEE---CCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeC--C
Q 020784 180 ----SVKLR--RDRIIVVL---EQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYA--S 248 (321)
Q Consensus 180 ----~v~~~--~~~~~~~~---~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~--~ 248 (321)
...++ .+.+++.. ...|.+.|+...+.+..+... +|..+-|.++..+... +.||.+.-..+. .
T Consensus 95 ~~~~~~~ls~dgk~~~V~N~TPa~SVtVVDl~~~kvv~ei~~P----GC~~iyP~~~~~F~~l--C~DGsl~~v~Ld~~G 168 (342)
T PF06433_consen 95 PYKNMFALSADGKFLYVQNFTPATSVTVVDLAAKKVVGEIDTP----GCWLIYPSGNRGFSML--CGDGSLLTVTLDADG 168 (342)
T ss_dssp --GGGEEE-TTSSEEEEEEESSSEEEEEEETTTTEEEEEEEGT----SEEEEEEEETTEEEEE--ETTSCEEEEEETSTS
T ss_pred ccccceEEccCCcEEEEEccCCCCeEEEEECCCCceeeeecCC----CEEEEEecCCCceEEE--ecCCceEEEEECCCC
Confidence 12333 23344432 247888888888888777653 3555555554445443 455655543332 2
Q ss_pred cceE----Eeeccccce-eEEEECCCCCEEEEEeCCCcEEEEEEcCCCc
Q 020784 249 KRTK----FIMAHDSRI-ACFALTQDGQLLATSSTKGTLVRIFNTLDGT 292 (321)
Q Consensus 249 ~~~~----~l~~H~~~V-~~vafspdg~~las~S~Dgt~IrIWd~~tg~ 292 (321)
+... .|..-+.++ ..=++...+..+.=-|..|. |+--|+...+
T Consensus 169 k~~~~~t~~F~~~~dp~f~~~~~~~~~~~~~F~Sy~G~-v~~~dlsg~~ 216 (342)
T PF06433_consen 169 KEAQKSTKVFDPDDDPLFEHPAYSRDGGRLYFVSYEGN-VYSADLSGDS 216 (342)
T ss_dssp SEEEEEEEESSTTTS-B-S--EEETTTTEEEEEBTTSE-EEEEEETTSS
T ss_pred CEeEeeccccCCCCcccccccceECCCCeEEEEecCCE-EEEEeccCCc
Confidence 2211 121111222 22234444433444566776 6666665443
No 426
>PRK10115 protease 2; Provisional
Probab=81.90 E-value=63 Score=32.86 Aligned_cols=202 Identities=9% Similarity=0.003 Sum_probs=101.5
Q ss_pred CeEEEEEcCCCCEEEEEcC-Cc-----EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 87 TLLHISFNQDHGCFAAGTD-HG-----FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~-~g-----v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
.+..+.++|||++||.+.+ +| +++.|+.++..+... . .+....++|..+++.++...-.+.. -....|..
T Consensus 128 ~l~~~~~Spdg~~la~~~d~~G~E~~~l~v~d~~tg~~l~~~-i--~~~~~~~~w~~D~~~~~y~~~~~~~-~~~~~v~~ 203 (686)
T PRK10115 128 TLGGMAITPDNTIMALAEDFLSRRQYGIRFRNLETGNWYPEL-L--DNVEPSFVWANDSWTFYYVRKHPVT-LLPYQVWR 203 (686)
T ss_pred EEeEEEECCCCCEEEEEecCCCcEEEEEEEEECCCCCCCCcc-c--cCcceEEEEeeCCCEEEEEEecCCC-CCCCEEEE
Confidence 5778899999999997766 33 456677766532111 1 1222457888888877666532210 12367888
Q ss_pred EeCCCC--cEEEEEeeCC-cee-EEEEe--CCeEEEEE----CCEEEEEEc--CCcEEEEEEeccCCCCceEEEeeCCCc
Q 020784 161 WDDHQS--RCIGELSFRS-EVR-SVKLR--RDRIIVVL----EQKIFVYNF--ADLKLLHQIETIANPKGLCAVSQGVGS 228 (321)
Q Consensus 161 WD~~~~--~~~~~~~~~~-~v~-~v~~~--~~~~~~~~----~~~I~iwd~--~~~~~~~~l~~~~~~~~~~~~s~~~d~ 228 (321)
+++.++ +....+.... ... .+... .+.+++.. ++.+.+|+. .+++....+... ... ...+...++
T Consensus 204 h~lgt~~~~d~lv~~e~~~~~~~~~~~s~d~~~l~i~~~~~~~~~~~l~~~~~~~~~~~~~~~~~-~~~-~~~~~~~~~- 280 (686)
T PRK10115 204 HTIGTPASQDELVYEEKDDTFYVSLHKTTSKHYVVIHLASATTSEVLLLDAELADAEPFVFLPRR-KDH-EYSLDHYQH- 280 (686)
T ss_pred EECCCChhHCeEEEeeCCCCEEEEEEEcCCCCEEEEEEECCccccEEEEECcCCCCCceEEEECC-CCC-EEEEEeCCC-
Confidence 999887 3322333221 121 12222 23333332 247888884 233322222221 111 122222223
Q ss_pred eEEEeecCCCCcEEE--EeeC-CcceEEeecc-c-cceeEEEECCCCCEEEEEeCCCcEEEEEEcCC-CcEEEEE
Q 020784 229 LVLVCPGLQKGQVRV--EHYA-SKRTKFIMAH-D-SRIACFALTQDGQLLATSSTKGTLVRIFNTLD-GTLLQEE 297 (321)
Q Consensus 229 ~~la~sGs~dg~V~i--~d~~-~~~~~~l~~H-~-~~V~~vafspdg~~las~S~Dgt~IrIWd~~t-g~~i~~~ 297 (321)
.+.+.+.......+| .++. .+....+-.+ . ..|..+.+. .+.++++...+|. -+|+-+.. +..+..+
T Consensus 281 ~ly~~tn~~~~~~~l~~~~~~~~~~~~~l~~~~~~~~i~~~~~~-~~~l~~~~~~~g~-~~l~~~~~~~~~~~~l 353 (686)
T PRK10115 281 RFYLRSNRHGKNFGLYRTRVRDEQQWEELIPPRENIMLEGFTLF-TDWLVVEERQRGL-TSLRQINRKTREVIGI 353 (686)
T ss_pred EEEEEEcCCCCCceEEEecCCCcccCeEEECCCCCCEEEEEEEE-CCEEEEEEEeCCE-EEEEEEcCCCCceEEe
Confidence 333333322223334 4443 2333455555 3 368888887 3456666666765 66665442 3344444
No 427
>PF07676 PD40: WD40-like Beta Propeller Repeat; InterPro: IPR011659 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events. This region appears to be related to the IPR001680 from INTERPRO repeat. This model is likely to miss copies within a sequence.; PDB: 2HQS_D 1C5K_A 2IVZ_A 2W8B_D 3IAX_A 1CRZ_A 1N6F_D 1N6D_C 1N6E_C 1K32_A ....
Probab=81.03 E-value=5.8 Score=23.32 Aligned_cols=30 Identities=20% Similarity=0.335 Sum_probs=19.9
Q ss_pred ccccceeEEEECCCCCEEEEEeCC---CcEEEEE
Q 020784 256 AHDSRIACFALTQDGQLLATSSTK---GTLVRIF 286 (321)
Q Consensus 256 ~H~~~V~~vafspdg~~las~S~D---gt~IrIW 286 (321)
.....-...+|||||++|+=++.. |. -.||
T Consensus 6 ~~~~~~~~p~~SpDGk~i~f~s~~~~~g~-~diy 38 (39)
T PF07676_consen 6 NSPGDDGSPAWSPDGKYIYFTSNRNDRGS-FDIY 38 (39)
T ss_dssp -SSSSEEEEEE-TTSSEEEEEEECT--SS-EEEE
T ss_pred cCCccccCEEEecCCCEEEEEecCCCCCC-cCEE
Confidence 344567788999999988876654 44 5555
No 428
>PF07569 Hira: TUP1-like enhancer of split; InterPro: IPR011494 The Hira proteins are found in a range of eukaryotes and are implicated in the assembly of repressive chromatin. These proteins also contain IPR001680 from INTERPRO.; GO: 0006355 regulation of transcription, DNA-dependent, 0005634 nucleus
Probab=80.70 E-value=15 Score=31.44 Aligned_cols=32 Identities=13% Similarity=0.159 Sum_probs=23.5
Q ss_pred EEEcCCCCEEEEEcCCc-EEEEEecCCceeEEe
Q 020784 91 ISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRR 122 (321)
Q Consensus 91 v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~ 122 (321)
+.+..++.+|++-..+| +.+||+.+.+..+..
T Consensus 16 ~~l~~~~~~Ll~iT~~G~l~vWnl~~~k~~~~~ 48 (219)
T PF07569_consen 16 SFLECNGSYLLAITSSGLLYVWNLKKGKAVLPP 48 (219)
T ss_pred EEEEeCCCEEEEEeCCCeEEEEECCCCeeccCC
Confidence 33566788888888766 779999988765443
No 429
>PF12657 TFIIIC_delta: Transcription factor IIIC subunit delta N-term; InterPro: IPR024761 This entry represents a domain found towards the N terminus of the 90 kDa subunit of transcription factor IIIC (also known as subunit 9 in yeast []). The whole subunit is involved in RNA polymerase III-mediated transcription. It is possible that this N-terminal domain interacts with TFIIIC subunit 8 [].
Probab=80.34 E-value=10 Score=31.08 Aligned_cols=24 Identities=17% Similarity=0.302 Sum_probs=18.9
Q ss_pred eEEEEEcCCCCEEEEEcCCcEEEEE
Q 020784 88 LLHISFNQDHGCFAAGTDHGFRIYN 112 (321)
Q Consensus 88 V~~v~fs~dg~~lasg~~~gv~vw~ 112 (321)
..+|+||.||+ ||.+.++.|.|.+
T Consensus 7 ~~~l~WS~Dg~-laV~t~~~v~IL~ 30 (173)
T PF12657_consen 7 PNALAWSEDGQ-LAVATGESVHILD 30 (173)
T ss_pred CcCeeECCCCC-EEEEcCCeEEEEe
Confidence 46899999996 7777777877763
No 430
>KOG2377 consensus Uncharacterized conserved protein [Function unknown]
Probab=80.28 E-value=26 Score=33.36 Aligned_cols=61 Identities=20% Similarity=0.236 Sum_probs=40.9
Q ss_pred cccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCc----EEEEEeCCCcceeEEEeec-CceEEEee
Q 020784 257 HDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGT----LLQEECCPSISAQSGLWLS-SAWLRVLR 319 (321)
Q Consensus 257 H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~----~i~~~~~g~~~~~~~~s~d-~~~la~~~ 319 (321)
-.++|.+|.||+|.+.||.--.|++ |.+++....+ ..++++.++ ..++.|.|. +.=+|..+
T Consensus 65 d~G~I~SIkFSlDnkilAVQR~~~~-v~f~nf~~d~~~l~~~~~ck~k~-~~IlGF~W~~s~e~A~i~ 130 (657)
T KOG2377|consen 65 DKGEIKSIKFSLDNKILAVQRTSKT-VDFCNFIPDNSQLEYTQECKTKN-ANILGFCWTSSTEIAFIT 130 (657)
T ss_pred CCCceeEEEeccCcceEEEEecCce-EEEEecCCCchhhHHHHHhccCc-ceeEEEEEecCeeEEEEe
Confidence 4568999999999999999999999 9999984322 223343332 234555544 34466544
No 431
>COG5167 VID27 Protein involved in vacuole import and degradation [Intracellular trafficking and secretion]
Probab=79.96 E-value=18 Score=34.86 Aligned_cols=118 Identities=10% Similarity=0.136 Sum_probs=62.2
Q ss_pred EEEEEEcCCcEEEEEEeccCCCCceEEEeeC-------CCceEEEeecCCCCcEEEEeeCCc-ceEEeeccccceeEEEE
Q 020784 195 KIFVYNFADLKLLHQIETIANPKGLCAVSQG-------VGSLVLVCPGLQKGQVRVEHYASK-RTKFIMAHDSRIACFAL 266 (321)
Q Consensus 195 ~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~-------~d~~~la~sGs~dg~V~i~d~~~~-~~~~l~~H~~~V~~vaf 266 (321)
+++--|+..|+.+.....+... ++-+.+. +.+.++. -+..+..+|.-...+ .+.. ...+..++.-.|
T Consensus 491 kLykmDIErGkvveeW~~~ddv--vVqy~p~~kf~qmt~eqtlvG--lS~~svFrIDPR~~gNKi~v-~esKdY~tKn~F 565 (776)
T COG5167 491 KLYKMDIERGKVVEEWDLKDDV--VVQYNPYFKFQQMTDEQTLVG--LSDYSVFRIDPRARGNKIKV-VESKDYKTKNKF 565 (776)
T ss_pred cceeeecccceeeeEeecCCcc--eeecCCchhHHhcCccceEEe--ecccceEEecccccCCceee-eeehhccccccc
Confidence 4555566778887777766543 3333332 1223333 255566777433222 2221 122233333333
Q ss_pred CC----CCCEEEEEeCCCcEEEEEEcCCCcEEEEEeC--CCcceeEEEeecCce-EEEee
Q 020784 267 TQ----DGQLLATSSTKGTLVRIFNTLDGTLLQEECC--PSISAQSGLWLSSAW-LRVLR 319 (321)
Q Consensus 267 sp----dg~~las~S~Dgt~IrIWd~~tg~~i~~~~~--g~~~~~~~~s~d~~~-la~~~ 319 (321)
|. ...|+|.||..|- ||+||-- |..-++.-- |.....+-.+.+|+| ||.|+
T Consensus 566 ss~~tTesGyIa~as~kGD-irLyDRi-g~rAKtalP~lG~aIk~idvta~Gk~ilaTCk 623 (776)
T COG5167 566 SSGMTTESGYIAAASRKGD-IRLYDRI-GKRAKTALPGLGDAIKHIDVTANGKHILATCK 623 (776)
T ss_pred cccccccCceEEEecCCCc-eeeehhh-cchhhhcCcccccceeeeEeecCCcEEEEeec
Confidence 32 2357899999999 9999843 333233222 333344566889988 55565
No 432
>PF14655 RAB3GAP2_N: Rab3 GTPase-activating protein regulatory subunit N-terminus
Probab=79.26 E-value=58 Score=30.85 Aligned_cols=50 Identities=18% Similarity=0.215 Sum_probs=37.6
Q ss_pred eeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCccee
Q 020784 254 IMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSISAQ 305 (321)
Q Consensus 254 l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~~~ 305 (321)
|......+.+|+.+|++++.|+.-.=|. |-++|+.++..++-++ |-..+.
T Consensus 303 l~D~~R~~~~i~~sP~~~laA~tDslGR-V~LiD~~~~~vvrmWK-GYRdAq 352 (415)
T PF14655_consen 303 LPDSKREGESICLSPSGRLAAVTDSLGR-VLLIDVARGIVVRMWK-GYRDAQ 352 (415)
T ss_pred eccCCceEEEEEECCCCCEEEEEcCCCc-EEEEECCCChhhhhhc-cCccce
Confidence 4455677999999999998887655566 9999999998877663 444333
No 433
>KOG2675 consensus Adenylate cyclase-associated protein (CAP/Srv2p) [Cytoskeleton; Signal transduction mechanisms]
Probab=78.14 E-value=2.2 Score=39.70 Aligned_cols=13 Identities=15% Similarity=0.299 Sum_probs=5.1
Q ss_pred EEEEECCEEEEEE
Q 020784 188 IIVVLEQKIFVYN 200 (321)
Q Consensus 188 ~~~~~~~~I~iwd 200 (321)
+-++.|+.|-+.+
T Consensus 383 ~svVfD~~Va~~e 395 (480)
T KOG2675|consen 383 TSVVFDDLVAIVE 395 (480)
T ss_pred eeEEEeccceeeE
Confidence 3333444333333
No 434
>KOG4499 consensus Ca2+-binding protein Regucalcin/SMP30 [Inorganic ion transport and metabolism; Signal transduction mechanisms]
Probab=77.83 E-value=37 Score=29.47 Aligned_cols=91 Identities=12% Similarity=0.048 Sum_probs=53.7
Q ss_pred EEEEEcCCCCEEEEEcC--CcEEEEE--ecCCce-----eEEeee-e-cCCce-EEEEEecCCCeEEEEeCCCCCCCCCC
Q 020784 89 LHISFNQDHGCFAAGTD--HGFRIYN--CDPFRE-----IFRRDF-E-RGGGI-GVVEMLFRCNILALVGGGPDPQYPLN 156 (321)
Q Consensus 89 ~~v~fs~dg~~lasg~~--~gv~vw~--~~~~~~-----~~~~~~-~-~~~~v-~~v~~~~~~~~~~~~sg~~~~~~~d~ 156 (321)
+.++|+.|-+.+..-.. -.|.-|| +.++.. ++...- + .++.. ..+++.-++++.+.+- +.+
T Consensus 161 Ngl~Wd~d~K~fY~iDsln~~V~a~dyd~~tG~~snr~~i~dlrk~~~~e~~~PDGm~ID~eG~L~Va~~-------ng~ 233 (310)
T KOG4499|consen 161 NGLAWDSDAKKFYYIDSLNYEVDAYDYDCPTGDLSNRKVIFDLRKSQPFESLEPDGMTIDTEGNLYVATF-------NGG 233 (310)
T ss_pred ccccccccCcEEEEEccCceEEeeeecCCCcccccCcceeEEeccCCCcCCCCCCcceEccCCcEEEEEe-------cCc
Confidence 45778877776665443 2344576 444432 221110 0 01100 1122334566655554 458
Q ss_pred cEEEEeCCCCcEEEEEeeCC-ceeEEEEeCC
Q 020784 157 KVMIWDDHQSRCIGELSFRS-EVRSVKLRRD 186 (321)
Q Consensus 157 ~v~iWD~~~~~~~~~~~~~~-~v~~v~~~~~ 186 (321)
+|.-.|..+|+.+.++.+.. .|+++||...
T Consensus 234 ~V~~~dp~tGK~L~eiklPt~qitsccFgGk 264 (310)
T KOG4499|consen 234 TVQKVDPTTGKILLEIKLPTPQITSCCFGGK 264 (310)
T ss_pred EEEEECCCCCcEEEEEEcCCCceEEEEecCC
Confidence 89999999999999999876 6889999764
No 435
>PF08728 CRT10: CRT10; InterPro: IPR014839 CRT10 is a transcriptional regulator of ribonucleotide reductase (RNR) genes []. RNR catalyses the rate limiting step in dNTP synthesis. Mutations in CRT10 have been shown to enhance hydroxyurea resistance [].
Probab=77.43 E-value=58 Score=33.06 Aligned_cols=81 Identities=14% Similarity=0.057 Sum_probs=49.2
Q ss_pred CCceEEEeecCCCCcEEEEeeCC-------c--------------ceEEeeccccceeEEEEC--CCCCEEEEEeCCCcE
Q 020784 226 VGSLVLVCPGLQKGQVRVEHYAS-------K--------------RTKFIMAHDSRIACFALT--QDGQLLATSSTKGTL 282 (321)
Q Consensus 226 ~d~~~la~sGs~dg~V~i~d~~~-------~--------------~~~~l~~H~~~V~~vafs--pdg~~las~S~Dgt~ 282 (321)
++..+|++ +..||.|.+|.... . +...++ -...++.++++ ...+++|.++.-..
T Consensus 112 g~~EVLl~-c~DdG~V~~Yyt~~I~~~i~~~~~~~~~~~~r~~i~P~f~~~-v~~SaWGLdIh~~~~~rlIAVSsNs~~- 188 (717)
T PF08728_consen 112 GGEEVLLL-CTDDGDVLAYYTETIIEAIERFSEDNDSGFSRLKIKPFFHLR-VGASAWGLDIHDYKKSRLIAVSSNSQE- 188 (717)
T ss_pred CCeeEEEE-EecCCeEEEEEHHHHHHHHHhhccccccccccccCCCCeEee-cCCceeEEEEEecCcceEEEEecCCce-
Confidence 34455653 79999999996421 0 111122 23468999998 77788887776666
Q ss_pred EEEEEcCCC--cEE--EEEeCCCcceeEEEe
Q 020784 283 VRIFNTLDG--TLL--QEECCPSISAQSGLW 309 (321)
Q Consensus 283 IrIWd~~tg--~~i--~~~~~g~~~~~~~~s 309 (321)
|.||-+... +.. .+...+|....++|.
T Consensus 189 VTVFaf~l~~~r~~~~~s~~~~hNIP~VSFl 219 (717)
T PF08728_consen 189 VTVFAFALVDERFYHVPSHQHSHNIPNVSFL 219 (717)
T ss_pred EEEEEEeccccccccccccccccCCCeeEee
Confidence 999976652 211 122345555556664
No 436
>KOG4441 consensus Proteins containing BTB/POZ and Kelch domains, involved in regulatory/signal transduction processes [Signal transduction mechanisms; General function prediction only]
Probab=77.16 E-value=73 Score=31.62 Aligned_cols=108 Identities=19% Similarity=0.135 Sum_probs=57.6
Q ss_pred CCCCEEEEEcCCc------EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcE
Q 020784 95 QDHGCFAAGTDHG------FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRC 168 (321)
Q Consensus 95 ~dg~~lasg~~~g------v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~ 168 (321)
-+|.+.|+|+.+| +-.||-.+.+......+ ....-.+-....++. +.+++|.+...-.-++|..||..++..
T Consensus 379 l~g~iYavGG~dg~~~l~svE~YDp~~~~W~~va~m-~~~r~~~gv~~~~g~-iYi~GG~~~~~~~l~sve~YDP~t~~W 456 (571)
T KOG4441|consen 379 LDGKLYAVGGFDGEKSLNSVECYDPVTNKWTPVAPM-LTRRSGHGVAVLGGK-LYIIGGGDGSSNCLNSVECYDPETNTW 456 (571)
T ss_pred ECCEEEEEeccccccccccEEEecCCCCcccccCCC-CcceeeeEEEEECCE-EEEEcCcCCCccccceEEEEcCCCCce
Confidence 3577888888654 45666666554333322 111112222233444 444444332111237799999998876
Q ss_pred EEEEee--CCceeEEEEeCCeEEEEEC-------CEEEEEEcCCc
Q 020784 169 IGELSF--RSEVRSVKLRRDRIIVVLE-------QKIFVYNFADL 204 (321)
Q Consensus 169 ~~~~~~--~~~v~~v~~~~~~~~~~~~-------~~I~iwd~~~~ 204 (321)
...-.. ...-..++.-.+.++++++ .+|..||..+.
T Consensus 457 ~~~~~M~~~R~~~g~a~~~~~iYvvGG~~~~~~~~~VE~ydp~~~ 501 (571)
T KOG4441|consen 457 TLIAPMNTRRSGFGVAVLNGKIYVVGGFDGTSALSSVERYDPETN 501 (571)
T ss_pred eecCCcccccccceEEEECCEEEEECCccCCCccceEEEEcCCCC
Confidence 543322 2223346666667766643 25888998654
No 437
>PF12657 TFIIIC_delta: Transcription factor IIIC subunit delta N-term; InterPro: IPR024761 This entry represents a domain found towards the N terminus of the 90 kDa subunit of transcription factor IIIC (also known as subunit 9 in yeast []). The whole subunit is involved in RNA polymerase III-mediated transcription. It is possible that this N-terminal domain interacts with TFIIIC subunit 8 [].
Probab=76.30 E-value=22 Score=29.12 Aligned_cols=31 Identities=23% Similarity=0.417 Sum_probs=26.1
Q ss_pred cceeEEEECCCC------CEEEEEeCCCcEEEEEEcCC
Q 020784 259 SRIACFALTQDG------QLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 259 ~~V~~vafspdg------~~las~S~Dgt~IrIWd~~t 290 (321)
..|.+++|||.| -+||....++. |.||.-..
T Consensus 86 ~~vv~~aWSP~Gl~~~~rClLavLTs~~~-l~l~~~~~ 122 (173)
T PF12657_consen 86 SQVVSAAWSPSGLGPNGRCLLAVLTSNGR-LSLYGPPG 122 (173)
T ss_pred ccEEEEEECCCCCCCCCceEEEEEcCCCe-EEEEecCC
Confidence 379999999965 47999999999 99998663
No 438
>COG5276 Uncharacterized conserved protein [Function unknown]
Probab=75.63 E-value=61 Score=29.18 Aligned_cols=166 Identities=10% Similarity=0.064 Sum_probs=96.4
Q ss_pred CCCeEEEEeCCCCCCCCCCcEEEEeCCCCc---EEEEEeeCCceeEEEEeCCeEEEEE-CCEEEEEEcCC---cEEEEEE
Q 020784 138 RCNILALVGGGPDPQYPLNKVMIWDDHQSR---CIGELSFRSEVRSVKLRRDRIIVVL-EQKIFVYNFAD---LKLLHQI 210 (321)
Q Consensus 138 ~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~---~~~~~~~~~~v~~v~~~~~~~~~~~-~~~I~iwd~~~---~~~~~~l 210 (321)
..++...+- .+..++|.|+.+.. .+..+...+.-+++..+.+...++. ++..-++|+.+ .++.-.+
T Consensus 95 se~yvyvad-------~ssGL~IvDIS~P~sP~~~~~lnt~gyaygv~vsGn~aYVadlddgfLivdvsdpssP~lagry 167 (370)
T COG5276 95 SEEYVYVAD-------WSSGLRIVDISTPDSPTLIGFLNTDGYAYGVYVSGNYAYVADLDDGFLIVDVSDPSSPQLAGRY 167 (370)
T ss_pred cccEEEEEc-------CCCceEEEeccCCCCcceeccccCCceEEEEEecCCEEEEeeccCcEEEEECCCCCCceeeeee
Confidence 345555554 23679999987654 3334444556677888888887774 67777888754 2333333
Q ss_pred eccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEEeeccc---cceeEEEECCCCCEEEEEeCCCcEEEEEE
Q 020784 211 ETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKFIMAHD---SRIACFALTQDGQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 211 ~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~H~---~~V~~vafspdg~~las~S~Dgt~IrIWd 287 (321)
........-.++ .++-.+.| ..|+-+.|-|......-+|.+|- ..++++..+++..+++...+. +-|-|
T Consensus 168 a~~~~d~~~v~I--SGn~AYvA---~~d~GL~ivDVSnp~sPvli~~~n~g~g~~sv~vsdnr~y~vvy~eg---vlivd 239 (370)
T COG5276 168 ALPGGDTHDVAI--SGNYAYVA---WRDGGLTIVDVSNPHSPVLIGSYNTGPGTYSVSVSDNRAYLVVYDEG---VLIVD 239 (370)
T ss_pred ccCCCCceeEEE--ecCeEEEE---EeCCCeEEEEccCCCCCeEEEEEecCCceEEEEecCCeeEEEEcccc---eEEEe
Confidence 222111112223 33333443 35667777777655444565552 368999999988888766432 55777
Q ss_pred cCCCc---EEEEEeCCCcceeEEEeecCceEEEe
Q 020784 288 TLDGT---LLQEECCPSISAQSGLWLSSAWLRVL 318 (321)
Q Consensus 288 ~~tg~---~i~~~~~g~~~~~~~~s~d~~~la~~ 318 (321)
..+-+ .+.+++......+..+.-+++|.-++
T Consensus 240 ~s~~ssp~~~gsyet~~p~~~s~v~Vs~~~~Yva 273 (370)
T COG5276 240 VSGPSSPTVFGSYETSNPVSISTVPVSGEYAYVA 273 (370)
T ss_pred cCCCCCceEeeccccCCcccccceecccceeeee
Confidence 76654 45555544444444566666666554
No 439
>KOG4460 consensus Nuclear pore complex, Nup88/rNup84 component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=75.05 E-value=57 Score=31.72 Aligned_cols=27 Identities=7% Similarity=0.076 Sum_probs=22.7
Q ss_pred CeEEEEEcCCCCEEEEEcCCcEEEEEe
Q 020784 87 TLLHISFNQDHGCFAAGTDHGFRIYNC 113 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~~gv~vw~~ 113 (321)
.|.-|..++.|..+|-.+-+|+.|..+
T Consensus 105 eV~~vl~s~~GS~VaL~G~~Gi~vMeL 131 (741)
T KOG4460|consen 105 EVYQVLLSPTGSHVALIGIKGLMVMEL 131 (741)
T ss_pred EEEEEEecCCCceEEEecCCeeEEEEc
Confidence 578889999999999888888877655
No 440
>KOG4327 consensus mRNA splicing protein SMN (survival motor neuron) [RNA processing and modification]
Probab=74.50 E-value=2.5 Score=34.94 Aligned_cols=22 Identities=41% Similarity=0.786 Sum_probs=18.7
Q ss_pred cCCCCCCCCCCCCCCCCCCCCc
Q 020784 8 SSPWPEPTPDPNPNPNPNSNTS 29 (321)
Q Consensus 8 ~~~~~~~~~~~~~~~~~~~~~~ 29 (321)
+-||++=-|||||+|+|+...+
T Consensus 162 s~p~~sfmpppPP~pp~i~p~~ 183 (218)
T KOG4327|consen 162 SAPWNSFMPPPPPMPPPICPDS 183 (218)
T ss_pred cCCccccCCCCCCCCcccCCCC
Confidence 5689999999999999987663
No 441
>KOG2247 consensus WD40 repeat-containing protein [General function prediction only]
Probab=74.30 E-value=0.35 Score=45.71 Aligned_cols=122 Identities=20% Similarity=0.257 Sum_probs=73.3
Q ss_pred CCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCe--EEEE--ECCEEEEEEcCCcEEEEEEeccCC-CCceEEEeeCCCc
Q 020784 154 PLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDR--IIVV--LEQKIFVYNFADLKLLHQIETIAN-PKGLCAVSQGVGS 228 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~--~~~~--~~~~I~iwd~~~~~~~~~l~~~~~-~~~~~~~s~~~d~ 228 (321)
.+..|..||-. ++.+.+......-..++|..+. +++. ..+.+.+||+.+... +.++.... ......++. ..
T Consensus 54 a~tiv~~YD~a-gq~~le~n~tg~aldm~wDkegdvlavlAek~~piylwd~n~eyt-qqLE~gg~~s~sll~wsK--g~ 129 (615)
T KOG2247|consen 54 ANTIVIYYDKA-GQVILELNPTGKALDMAWDKEGDVLAVLAEKTGPIYLWDVNSEYT-QQLESGGTSSKSLLAWSK--GT 129 (615)
T ss_pred hhhHHHhhhhh-cceecccCCchhHhhhhhccccchhhhhhhcCCCeeechhhhhhH-HHHhccCcchHHHHhhcc--CC
Confidence 35678888754 3344444444455556665432 3332 457999999964321 22322211 112233343 33
Q ss_pred eEEEeecCCCCcEEEEeeCCcceE-EeeccccceeEEEECCCCCEEEEEeCCCc
Q 020784 229 LVLVCPGLQKGQVRVEHYASKRTK-FIMAHDSRIACFALTQDGQLLATSSTKGT 281 (321)
Q Consensus 229 ~~la~sGs~dg~V~i~d~~~~~~~-~l~~H~~~V~~vafspdg~~las~S~Dgt 281 (321)
..++. |...|.+.|++....... ..-.|...++++++.+.+. .+.++.|.+
T Consensus 130 ~el~i-g~~~gn~viynhgtsR~iiv~Gkh~RRgtq~av~lEd~-vil~dcd~~ 181 (615)
T KOG2247|consen 130 PELVI-GNNAGNIVIYNHGTSRRIIVMGKHQRRGTQIAVTLEDY-VILCDCDNT 181 (615)
T ss_pred ccccc-cccccceEEEeccchhhhhhhcccccceeEEEecccce-eeecCcHHH
Confidence 55664 888999999887765533 4444999999999998765 556766765
No 442
>PF10395 Utp8: Utp8 family; InterPro: IPR018843 Utp8 is an essential component of the nuclear tRNA export machinery in Saccharomyces cerevisiae (Baker's yeast). It is a tRNA binding protein that acts at a step between tRNA maturation /aminoacylation, and translocation of the tRNA across the nuclear pore complex [].
Probab=73.68 E-value=1.1e+02 Score=30.97 Aligned_cols=158 Identities=13% Similarity=0.142 Sum_probs=84.7
Q ss_pred CCeEEEEEcCCCCEEEEEcCCc-EEEEEecCCceeE--EeeeecCCceE---EEEEe---cCCCeEEEEeC-CCCCCCCC
Q 020784 86 PTLLHISFNQDHGCFAAGTDHG-FRIYNCDPFREIF--RRDFERGGGIG---VVEML---FRCNILALVGG-GPDPQYPL 155 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~--~~~~~~~~~v~---~v~~~---~~~~~~~~~sg-~~~~~~~d 155 (321)
++|-.|.|..+++.+++--..| |.+||.+...... .....+...+. .+... ...+.+.+++. .. ..
T Consensus 130 ~kvv~Ik~~~~~~~I~vvl~nG~i~~~d~~~~~l~~~~~l~~~~~~~v~ys~fv~~~~~~~~~~~ll~v~~~~~----~k 205 (670)
T PF10395_consen 130 DKVVGIKFSSDGKIIYVVLENGSIQIYDFSENSLEKVPQLKLKSSINVSYSKFVNDFELENGKDLLLTVSQLSN----SK 205 (670)
T ss_pred cceEEEEEecCCCEEEEEEcCCcEEEEeccccccccccccccccccceehhhhhcccccccCCceEEEEEEcCC----Cc
Confidence 5899999999999888887755 7899983222111 11110111111 11111 12344555542 11 12
Q ss_pred CcEEEEeC-CCCcEEEEEe---eC-C--ceeEEEEeCCeEEEEECCEEEEEEcCCcEEEEEEeccC--CC--CceEEEee
Q 020784 156 NKVMIWDD-HQSRCIGELS---FR-S--EVRSVKLRRDRIIVVLEQKIFVYNFADLKLLHQIETIA--NP--KGLCAVSQ 224 (321)
Q Consensus 156 ~~v~iWD~-~~~~~~~~~~---~~-~--~v~~v~~~~~~~~~~~~~~I~iwd~~~~~~~~~l~~~~--~~--~~~~~~s~ 224 (321)
-..|++.+ .....+.++. .+ . .=..+++....++.-.+++|.+|++.+.+..+++.-.. .. ...+++.+
T Consensus 206 ~~ykL~~l~~~~~~~~El~s~~~e~~~~~~s~f~Y~~G~LY~l~~~~i~~ysip~f~~~~tI~l~~ii~~~~~~~vSl~~ 285 (670)
T PF10395_consen 206 LSYKLISLSNESSSIFELSSTILENFGLEDSKFCYQFGKLYQLSKKTISSYSIPNFQIQKTISLPSIIDKESDDLVSLKP 285 (670)
T ss_pred EEEEEEEeccCCcceEEeehheeccCCcccceEEEeCCEEEEEeCCEEEEEEcCCceEEEEEEechhhccccccceEeec
Confidence 34677776 1222222332 11 1 11234445555666678899999999998888876531 11 12444443
Q ss_pred CCCceEEEeecCCCCcEEEEeeCCcc
Q 020784 225 GVGSLVLVCPGLQKGQVRVEHYASKR 250 (321)
Q Consensus 225 ~~d~~~la~sGs~dg~V~i~d~~~~~ 250 (321)
-..+++|. +.+++|.+.|+....
T Consensus 286 ~s~nRvLL---s~~nkIyLld~~~~s 308 (670)
T PF10395_consen 286 PSPNRVLL---SVNNKIYLLDLKFES 308 (670)
T ss_pred CCCCeEEE---EcCCEEEEEeehhhh
Confidence 33345665 455689998876543
No 443
>smart00564 PQQ beta-propeller repeat. Beta-propeller repeat occurring in enzymes with pyrrolo-quinoline quinone (PQQ) as cofactor, in Ire1p-like Ser/Thr kinases, and in prokaryotic dehydrogenases.
Probab=73.46 E-value=9.3 Score=21.29 Aligned_cols=25 Identities=24% Similarity=0.304 Sum_probs=19.8
Q ss_pred EEEEEeCCCcEEEEEEcCCCcEEEEE
Q 020784 272 LLATSSTKGTLVRIFNTLDGTLLQEE 297 (321)
Q Consensus 272 ~las~S~Dgt~IrIWd~~tg~~i~~~ 297 (321)
.+..++.+|. +..+|.++|+.+-++
T Consensus 8 ~v~~~~~~g~-l~a~d~~~G~~~W~~ 32 (33)
T smart00564 8 TVYVGSTDGT-LYALDAKTGEILWTY 32 (33)
T ss_pred EEEEEcCCCE-EEEEEcccCcEEEEc
Confidence 4566777898 999999999987654
No 444
>PF01011 PQQ: PQQ enzyme repeat family.; InterPro: IPR002372 Pyrrolo-quinoline quinone (PQQ) is a redox coenzyme, which serves as a cofactor for a number of enzymes (quinoproteins) and particularly for some bacterial dehydrogenases [, ]. A number of bacterial quinoproteins belong to this family. Enzymes in this group have repeats of a beta propeller.; PDB: 1H4I_C 1H4J_E 1W6S_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A 1G72_A ....
Probab=73.17 E-value=11 Score=22.17 Aligned_cols=28 Identities=11% Similarity=0.089 Sum_probs=22.8
Q ss_pred EEEeCCCcEEEEEEcCCCcEEEEEeCCCc
Q 020784 274 ATSSTKGTLVRIFNTLDGTLLQEECCPSI 302 (321)
Q Consensus 274 as~S~Dgt~IrIWd~~tg~~i~~~~~g~~ 302 (321)
..++.||. |.-.|.+||+.+-+++.+..
T Consensus 4 ~~~~~~g~-l~AlD~~TG~~~W~~~~~~~ 31 (38)
T PF01011_consen 4 YVGTPDGY-LYALDAKTGKVLWKFQTGPP 31 (38)
T ss_dssp EEETTTSE-EEEEETTTTSEEEEEESSSG
T ss_pred EEeCCCCE-EEEEECCCCCEEEeeeCCCC
Confidence 34588999 99999999999988876544
No 445
>TIGR03074 PQQ_membr_DH membrane-bound PQQ-dependent dehydrogenase, glucose/quinate/shikimate family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Members of this family have several predicted transmembrane helices in the N-terminal region, and include the quinoprotein glucose dehydrogenase (EC 1.1.5.2) of Escherichia coli and the quinate/shikimate dehydrogenase of Acinetobacter sp. ADP1 (EC 1.1.99.25). Sequences closely related except for the absense of the N-terminal hydrophobic region, scoring in the gray zone between the trusted and noise cutoffs, include PQQ-dependent glycerol (EC 1.1.99.22) and and other polyol (sugar alcohol) dehydrogenases.
Probab=72.83 E-value=1.2e+02 Score=31.30 Aligned_cols=21 Identities=24% Similarity=0.287 Sum_probs=17.7
Q ss_pred CCcEEEEEEcCCCcEEEEEeCC
Q 020784 279 KGTLVRIFNTLDGTLLQEECCP 300 (321)
Q Consensus 279 Dgt~IrIWd~~tg~~i~~~~~g 300 (321)
+|. |+-+|++||+++-++..+
T Consensus 335 ~G~-I~A~Da~TGkl~W~~~~g 355 (764)
T TIGR03074 335 SGV-IRAFDVNTGALVWAWDPG 355 (764)
T ss_pred CcE-EEEEECCCCcEeeEEecC
Confidence 577 999999999999877654
No 446
>PF01436 NHL: NHL repeat; InterPro: IPR001258 The NHL repeat, named after NCL-1, HT2A and Lin-41, is found largely in a large number of eukaryotic and prokaryotic proteins. For example, the repeat is found in a variety of enzymes of the copper type II, ascorbate-dependent monooxygenase family which catalyse the C terminus alpha-amidation of biological peptides []. In many it occurs in tandem arrays, for example in the ringfinger beta-box, coiled-coil (RBCC) eukaryotic growth regulators []. The 'Brain Tumor' protein (Brat) is one such growth regulator that contains a 6-bladed NHL-repeat beta-propeller [, ]. The NHL repeats are also found in serine/threonine protein kinase (STPK) in diverse range of pathogenic bacteria. These STPK are transmembrane receptors with a intracellular N-terminal kinase domain and extracellular C-terminal sensor domain. In the STPK, PknD, from Mycobacterium tuberculosis, the sensor domain forms a rigid, six-bladed b-propeller composed of NHL repeats with a flexible tether to the transmembrane domain.; GO: 0005515 protein binding; PDB: 3FVZ_A 3FW0_A 1RWL_A 1RWI_A 1Q7F_A.
Probab=72.57 E-value=9.8 Score=20.77 Aligned_cols=25 Identities=24% Similarity=0.407 Sum_probs=16.3
Q ss_pred eeEEEECCCCCEEEEEeCCCcEEEEE
Q 020784 261 IACFALTQDGQLLATSSTKGTLVRIF 286 (321)
Q Consensus 261 V~~vafspdg~~las~S~Dgt~IrIW 286 (321)
...|+++++|.++++=+.... |++|
T Consensus 4 P~gvav~~~g~i~VaD~~n~r-V~vf 28 (28)
T PF01436_consen 4 PHGVAVDSDGNIYVADSGNHR-VQVF 28 (28)
T ss_dssp EEEEEEETTSEEEEEECCCTE-EEEE
T ss_pred CcEEEEeCCCCEEEEECCCCE-EEEC
Confidence 567777777777766655555 6554
No 447
>PF02897 Peptidase_S9_N: Prolyl oligopeptidase, N-terminal beta-propeller domain; InterPro: IPR004106 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This entry represents the beta-propeller domain found at the N-terminal of prolyl oligopeptidase, including acylamino-acid-releasing enzyme (also known as acylaminoacyl peptidase), which belong to the MEROPS peptidase family S9 (clan SC), subfamily S9A. The prolyl oligopeptidase family consist of a number of evolutionary related peptidases whose catalytic activity seems to be provided by a charge relay system similar to that of the trypsin family of serine proteases, but which evolved by independent convergent evolution. The N-terminal domain of prolyl oligopeptidases form an unusual 7-bladed beta-propeller consisting of seven 4-stranded beta-sheet motifs. Prolyl oligopeptidase is a large cytosolic enzyme involved in the maturation and degradation of peptide hormones and neuropeptides, which relate to the induction of amnesia. The enzyme contains a peptidase domain, where its catalytic triad (Ser554, His680, Asp641) is covered by the central tunnel of the N-terminal beta-propeller domain. In this way, large structured peptides are excluded from the active site, thereby protecting larger peptides and proteins from proteolysis in the cytosol []. The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. Mammalian acylaminoacyl peptidase is an exopeptidase that is a member of the same prolyl oligopeptidase family of serine peptidases. This enzyme removes acylated amino acid residues from the N terminus of oligopeptides [].; GO: 0004252 serine-type endopeptidase activity, 0006508 proteolysis; PDB: 2BKL_B 3DDU_A 1YR2_A 2XE4_A 1VZ3_A 3EQ9_A 1O6F_A 3EQ7_A 4AN0_A 1UOP_A ....
Probab=71.81 E-value=88 Score=29.25 Aligned_cols=197 Identities=16% Similarity=0.063 Sum_probs=104.2
Q ss_pred EEEEcCCCCEEEEEc-CC---------c--EEEEEecCCcee--EEeeeecCCc--eEEEEEecCCCeEEEEeCCCCCCC
Q 020784 90 HISFNQDHGCFAAGT-DH---------G--FRIYNCDPFREI--FRRDFERGGG--IGVVEMLFRCNILALVGGGPDPQY 153 (321)
Q Consensus 90 ~v~fs~dg~~lasg~-~~---------g--v~vw~~~~~~~~--~~~~~~~~~~--v~~v~~~~~~~~~~~~sg~~~~~~ 153 (321)
.+.|.+||+.|.... +. . |..|.+.+.... ...+. .... ...+..+.+++.+++.....
T Consensus 174 ~~~W~~d~~~~~y~~~~~~~~~~~~~~~~~v~~~~~gt~~~~d~lvfe~-~~~~~~~~~~~~s~d~~~l~i~~~~~---- 248 (414)
T PF02897_consen 174 SVSWSDDGKGFFYTRFDEDQRTSDSGYPRQVYRHKLGTPQSEDELVFEE-PDEPFWFVSVSRSKDGRYLFISSSSG---- 248 (414)
T ss_dssp EEEECTTSSEEEEEECSTTTSS-CCGCCEEEEEEETTS-GGG-EEEEC--TTCTTSEEEEEE-TTSSEEEEEEESS----
T ss_pred eEEEeCCCCEEEEEEeCcccccccCCCCcEEEEEECCCChHhCeeEEee-cCCCcEEEEEEecCcccEEEEEEEcc----
Confidence 389999988765433 32 2 456666555432 22222 1222 45567788888877665443
Q ss_pred CC-CcEEEEeCCCC-----cEEEEEe-eCCceeEEEEeCCeEEEEEC-----CEEEEEEcCCcEE---EEEEeccCCCCc
Q 020784 154 PL-NKVMIWDDHQS-----RCIGELS-FRSEVRSVKLRRDRIIVVLE-----QKIFVYNFADLKL---LHQIETIANPKG 218 (321)
Q Consensus 154 ~d-~~v~iWD~~~~-----~~~~~~~-~~~~v~~v~~~~~~~~~~~~-----~~I~iwd~~~~~~---~~~l~~~~~~~~ 218 (321)
.+ ..+.+-|+..+ ....... .......+....+.+++.++ +.|...++.+... ...+..+.....
T Consensus 249 ~~~s~v~~~d~~~~~~~~~~~~~l~~~~~~~~~~v~~~~~~~yi~Tn~~a~~~~l~~~~l~~~~~~~~~~~l~~~~~~~~ 328 (414)
T PF02897_consen 249 TSESEVYLLDLDDGGSPDAKPKLLSPREDGVEYYVDHHGDRLYILTNDDAPNGRLVAVDLADPSPAEWWTVLIPEDEDVS 328 (414)
T ss_dssp SSEEEEEEEECCCTTTSS-SEEEEEESSSS-EEEEEEETTEEEEEE-TT-TT-EEEEEETTSTSGGGEEEEEE--SSSEE
T ss_pred ccCCeEEEEeccccCCCcCCcEEEeCCCCceEEEEEccCCEEEEeeCCCCCCcEEEEecccccccccceeEEcCCCCcee
Confidence 23 67888898875 2222222 23344556666777777664 3677777765542 223444433344
Q ss_pred eEEEeeCCCceEEEeecCCCC--cEEEEeeC-CcceEEeec-cccceeEEEECCCCC-EEEEE-eC--CCcEEEEEEcCC
Q 020784 219 LCAVSQGVGSLVLVCPGLQKG--QVRVEHYA-SKRTKFIMA-HDSRIACFALTQDGQ-LLATS-ST--KGTLVRIFNTLD 290 (321)
Q Consensus 219 ~~~~s~~~d~~~la~sGs~dg--~V~i~d~~-~~~~~~l~~-H~~~V~~vafspdg~-~las~-S~--Dgt~IrIWd~~t 290 (321)
+..+....+..++ ....++ .|+++++. ......+.. -.+.|..+...+++. ++.+. |. .++ |.-+|+.+
T Consensus 329 l~~~~~~~~~Lvl--~~~~~~~~~l~v~~~~~~~~~~~~~~p~~g~v~~~~~~~~~~~~~~~~ss~~~P~~-~y~~d~~t 405 (414)
T PF02897_consen 329 LEDVSLFKDYLVL--SYRENGSSRLRVYDLDDGKESREIPLPEAGSVSGVSGDFDSDELRFSYSSFTTPPT-VYRYDLAT 405 (414)
T ss_dssp EEEEEEETTEEEE--EEEETTEEEEEEEETT-TEEEEEEESSSSSEEEEEES-TT-SEEEEEEEETTEEEE-EEEEETTT
T ss_pred EEEEEEECCEEEE--EEEECCccEEEEEECCCCcEEeeecCCcceEEeccCCCCCCCEEEEEEeCCCCCCE-EEEEECCC
Confidence 5555555443333 345666 45558887 554443332 234466666555554 33333 22 446 77888888
Q ss_pred CcEE
Q 020784 291 GTLL 294 (321)
Q Consensus 291 g~~i 294 (321)
|+.-
T Consensus 406 ~~~~ 409 (414)
T PF02897_consen 406 GELT 409 (414)
T ss_dssp TCEE
T ss_pred CCEE
Confidence 8763
No 448
>KOG2377 consensus Uncharacterized conserved protein [Function unknown]
Probab=71.56 E-value=98 Score=29.69 Aligned_cols=107 Identities=14% Similarity=0.101 Sum_probs=65.1
Q ss_pred EEEEEcCCCCEEEEEcCCcEEEEEecCCceeE--EeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCC
Q 020784 89 LHISFNQDHGCFAAGTDHGFRIYNCDPFREIF--RRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQS 166 (321)
Q Consensus 89 ~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~--~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~ 166 (321)
+.+-|...++.|.+-..+|+.=|.+....-.. .......|.|..+.++.+...+|+-- .+++|.+.+....
T Consensus 26 ngvFfDDaNkqlfavrSggatgvvvkgpndDVpiSfdm~d~G~I~SIkFSlDnkilAVQR-------~~~~v~f~nf~~d 98 (657)
T KOG2377|consen 26 NGVFFDDANKQLFAVRSGGATGVVVKGPNDDVPISFDMDDKGEIKSIKFSLDNKILAVQR-------TSKTVDFCNFIPD 98 (657)
T ss_pred cceeeccCcceEEEEecCCeeEEEEeCCCCCCCceeeecCCCceeEEEeccCcceEEEEe-------cCceEEEEecCCC
Confidence 34556655565555555555555443322111 11111467899999999888887766 5789999987432
Q ss_pred cE----EEEEeeCC-ceeEEEEeCC-eEEEEECCEEEEEEcC
Q 020784 167 RC----IGELSFRS-EVRSVKLRRD-RIIVVLEQKIFVYNFA 202 (321)
Q Consensus 167 ~~----~~~~~~~~-~v~~v~~~~~-~~~~~~~~~I~iwd~~ 202 (321)
+. ..+++... .|...+|... .+++.++..+.+|...
T Consensus 99 ~~~l~~~~~ck~k~~~IlGF~W~~s~e~A~i~~~G~e~y~v~ 140 (657)
T KOG2377|consen 99 NSQLEYTQECKTKNANILGFCWTSSTEIAFITDQGIEFYQVL 140 (657)
T ss_pred chhhHHHHHhccCcceeEEEEEecCeeEEEEecCCeEEEEEc
Confidence 21 22333333 5888888765 4666777788888763
No 449
>PF14781 BBS2_N: Ciliary BBSome complex subunit 2, N-terminal
Probab=71.37 E-value=48 Score=26.04 Aligned_cols=52 Identities=19% Similarity=0.327 Sum_probs=38.2
Q ss_pred CCcEEEEeCCC--------CcEEEEEeeCCceeEEEEe-------CCeEEEEECCEEEEEEcCCcEE
Q 020784 155 LNKVMIWDDHQ--------SRCIGELSFRSEVRSVKLR-------RDRIIVVLEQKIFVYNFADLKL 206 (321)
Q Consensus 155 d~~v~iWD~~~--------~~~~~~~~~~~~v~~v~~~-------~~~~~~~~~~~I~iwd~~~~~~ 206 (321)
-++|.|.+... ...+..+.+...|++++-. .+.+++++...+..||+.+...
T Consensus 19 ~gKV~IH~ph~~~~~~~~~~~~i~~LNin~~italaaG~l~~~~~~D~LliGt~t~llaYDV~~N~d 85 (136)
T PF14781_consen 19 GGKVFIHNPHERGQRTGRQDSDISFLNINQEITALAAGRLKPDDGRDCLLIGTQTSLLAYDVENNSD 85 (136)
T ss_pred CCEEEEECCCccccccccccCceeEEECCCceEEEEEEecCCCCCcCEEEEeccceEEEEEcccCch
Confidence 37888887653 3356677888888888643 4568888999999999976543
No 450
>PF11715 Nup160: Nucleoporin Nup120/160; InterPro: IPR021717 Nup120 is conserved from fungi to plants to humans, and is homologous with the Nup160 of vertebrates. The nuclear core complex, or NPC, mediates macromolecular transport across the nuclear envelope. Deletion of the NUP120 gene causes clustering of NPCs at one side of the nuclear envelope, moderate nucleolar fragmentation and slower cell growth []. The vertebrate NPC is estimated to contain between 30 and 60 different proteins. most of which are not known. Two important ones in creating the nucleoporin basket are Nup98 and Nup153, and Nup120, in conjunction with Nup 133, interacts with these two and itself plays a role in mRNA export []. Nup160, Nup133, Nup96, and Nup107 are all targets of phosphorylation. The phosphorylation sites are clustered mainly at the N-terminal regions of these proteins, which are predicted to be natively disordered. The entire Nup107-160 subcomplex is stable throughout the cell cycle, thus it seems unlikely that phosphorylation affects interactions within the Nup107-160 subcomplex, but rather that it regulates the association of the subcomplex with the NPC and other proteins []. ; PDB: 3F7F_D 3H7N_D 3HXR_A.
Probab=70.67 E-value=12 Score=36.84 Aligned_cols=30 Identities=13% Similarity=0.380 Sum_probs=24.3
Q ss_pred CCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEee
Q 020784 138 RCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSF 174 (321)
Q Consensus 138 ~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~ 174 (321)
+...+++++ .|+++|+||+.+++++.+...
T Consensus 229 ~~~~l~tl~-------~D~~LRiW~l~t~~~~~~~~~ 258 (547)
T PF11715_consen 229 DDTFLFTLS-------RDHTLRIWSLETGQCLATIDL 258 (547)
T ss_dssp TTTEEEEEE-------TTSEEEEEETTTTCEEEEEET
T ss_pred CCCEEEEEe-------CCCeEEEEECCCCeEEEEecc
Confidence 566777777 789999999999999776543
No 451
>PF10647 Gmad1: Lipoprotein LpqB beta-propeller domain; InterPro: IPR018910 The Gmad1 domain is found associated with IPR019606 from INTERPRO, in bacterial spore formation. It is predicted to have a beta-propeller fold and to have a passive binding role rather than a catalytic function owing to the low number of conserved hydrophilic residues.
Probab=70.07 E-value=75 Score=27.74 Aligned_cols=122 Identities=11% Similarity=-0.017 Sum_probs=0.0
Q ss_pred CCEEEEEEcCCcEEEEEEeccCC-CCceEEEeeCCCceEEEeec--CCCCcEEEEeeCCcceEEeeccccceeEEEECCC
Q 020784 193 EQKIFVYNFADLKLLHQIETIAN-PKGLCAVSQGVGSLVLVCPG--LQKGQVRVEHYASKRTKFIMAHDSRIACFALTQD 269 (321)
Q Consensus 193 ~~~I~iwd~~~~~~~~~l~~~~~-~~~~~~~s~~~d~~~la~sG--s~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspd 269 (321)
|+.+-..+-...+.+........ .....++++++ ..+|+.. .....+.++.........+.+. .++.-.|+++
T Consensus 1 dG~l~~~~~~~~~pv~g~~~~~~~~~~s~AvS~dg--~~~A~v~~~~~~~~L~~~~~~~~~~~~~~g~--~l~~PS~d~~ 76 (253)
T PF10647_consen 1 DGQLVRVSGGGVTPVPGALGEGGYDVTSPAVSPDG--SRVAAVSEGDGGRSLYVGPAGGPVRPVLTGG--SLTRPSWDPD 76 (253)
T ss_pred CCcEEEecCCceeECCCCcCcCCccccceEECCCC--CeEEEEEEcCCCCEEEEEcCCCcceeeccCC--ccccccccCC
Q ss_pred CCEEEEEeCCCcEEEEE-EcCCCcEEEEEeCCC----cceeEEEeecCceEEEee
Q 020784 270 GQLLATSSTKGTLVRIF-NTLDGTLLQEECCPS----ISAQSGLWLSSAWLRVLR 319 (321)
Q Consensus 270 g~~las~S~Dgt~IrIW-d~~tg~~i~~~~~g~----~~~~~~~s~d~~~la~~~ 319 (321)
|...+....+.. .+++ +..+++....--... ....+.+|+||..+|+..
T Consensus 77 g~~W~v~~~~~~-~~~~~~~~~g~~~~~~v~~~~~~~~I~~l~vSpDG~RvA~v~ 130 (253)
T PF10647_consen 77 GWVWTVDDGSGG-VRVVRDSASGTGEPVEVDWPGLRGRITALRVSPDGTRVAVVV 130 (253)
T ss_pred CCEEEEEcCCCc-eEEEEecCCCcceeEEecccccCCceEEEEECCCCcEEEEEE
No 452
>TIGR02276 beta_rpt_yvtn 40-residue YVTN family beta-propeller repeat. This repeat of about 40 amino acids is found in up to 14 copies per protein. Archaea Methanosarcina mazei and Methanosarcina acetivorans each have over 10 genes that encode tandem copies of this repeat, which is also found in other species. PSIPRED predicts with high confidence that each 40-residue repeats contains four beta strands. This model overlaps somewhat with the NHL repeat (Pfam pfam01436) and also shows sequence similarity to the WD domain, G-beta repeat (Pfam pfam00400).
Probab=69.15 E-value=21 Score=20.96 Aligned_cols=29 Identities=17% Similarity=0.200 Sum_probs=20.9
Q ss_pred CCcEEEEeCCCCcEEEEEeeCCceeEEEE
Q 020784 155 LNKVMIWDDHQSRCIGELSFRSEVRSVKL 183 (321)
Q Consensus 155 d~~v~iWD~~~~~~~~~~~~~~~v~~v~~ 183 (321)
+++|.++|..+++.+..+........+.+
T Consensus 13 ~~~v~~id~~~~~~~~~i~vg~~P~~i~~ 41 (42)
T TIGR02276 13 SNTVSVIDTATNKVIATIPVGGYPFGVAV 41 (42)
T ss_pred CCEEEEEECCCCeEEEEEECCCCCceEEe
Confidence 47889999988888777776555555544
No 453
>KOG4460 consensus Nuclear pore complex, Nup88/rNup84 component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=69.14 E-value=74 Score=31.00 Aligned_cols=34 Identities=18% Similarity=0.211 Sum_probs=26.9
Q ss_pred ceeEEEECCCC---CEEEEEeCCCcEEEEEEcCCCcEE
Q 020784 260 RIACFALTQDG---QLLATSSTKGTLVRIFNTLDGTLL 294 (321)
Q Consensus 260 ~V~~vafspdg---~~las~S~Dgt~IrIWd~~tg~~i 294 (321)
.+..++|+|+. ..|..-+.|++ |||||+..-..+
T Consensus 167 tl~Qa~WHP~S~~D~hL~iL~sdnv-iRiy~lS~~tel 203 (741)
T KOG4460|consen 167 TLKQAAWHPSSILDPHLVLLTSDNV-IRIYSLSEPTEL 203 (741)
T ss_pred eeeeccccCCccCCceEEEEecCcE-EEEEecCCcchh
Confidence 46789999985 56667777999 999999876554
No 454
>KOG4499 consensus Ca2+-binding protein Regucalcin/SMP30 [Inorganic ion transport and metabolism; Signal transduction mechanisms]
Probab=67.15 E-value=86 Score=27.34 Aligned_cols=91 Identities=12% Similarity=0.116 Sum_probs=56.5
Q ss_pred EEeeCCCceEEEeecCCCCcEEEEee--CCcc------eEEeec----cccceeEEEECCCCCEEEEEeCCCcEEEEEEc
Q 020784 221 AVSQGVGSLVLVCPGLQKGQVRVEHY--ASKR------TKFIMA----HDSRIACFALTQDGQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 221 ~~s~~~d~~~la~sGs~dg~V~i~d~--~~~~------~~~l~~----H~~~V~~vafspdg~~las~S~Dgt~IrIWd~ 288 (321)
.++++.|...+-+.-+.+-.|.-||+ .++. +..++. ..-..-.+++.-+|.+.+++=..++ |.-+|.
T Consensus 162 gl~Wd~d~K~fY~iDsln~~V~a~dyd~~tG~~snr~~i~dlrk~~~~e~~~PDGm~ID~eG~L~Va~~ng~~-V~~~dp 240 (310)
T KOG4499|consen 162 GLAWDSDAKKFYYIDSLNYEVDAYDYDCPTGDLSNRKVIFDLRKSQPFESLEPDGMTIDTEGNLYVATFNGGT-VQKVDP 240 (310)
T ss_pred cccccccCcEEEEEccCceEEeeeecCCCcccccCcceeEEeccCCCcCCCCCCcceEccCCcEEEEEecCcE-EEEECC
Confidence 34444555555444666666766763 3322 222222 1112455677778998887776777 999999
Q ss_pred CCCcEEEEEeCCCcceeEEEeecCc
Q 020784 289 LDGTLLQEECCPSISAQSGLWLSSA 313 (321)
Q Consensus 289 ~tg~~i~~~~~g~~~~~~~~s~d~~ 313 (321)
.+|+.+.+++.-.. .+.+..|=|.
T Consensus 241 ~tGK~L~eiklPt~-qitsccFgGk 264 (310)
T KOG4499|consen 241 TTGKILLEIKLPTP-QITSCCFGGK 264 (310)
T ss_pred CCCcEEEEEEcCCC-ceEEEEecCC
Confidence 99999999976533 3445566665
No 455
>PF12341 DUF3639: Protein of unknown function (DUF3639) ; InterPro: IPR022100 This domain family is found in eukaryotes, and is approximately 30 amino acids in length. The family is found in association with PF00400 from PFAM. There are two completely conserved residues (E and R) that may be functionally important.
Probab=66.93 E-value=15 Score=20.15 Aligned_cols=24 Identities=8% Similarity=0.246 Sum_probs=19.9
Q ss_pred ceeEEEEeCCeEEEEEC-CEEEEEE
Q 020784 177 EVRSVKLRRDRIIVVLE-QKIFVYN 200 (321)
Q Consensus 177 ~v~~v~~~~~~~~~~~~-~~I~iwd 200 (321)
.|.+++..+..++++++ +.+|+|.
T Consensus 3 ~i~aia~g~~~vavaTS~~~lRifs 27 (27)
T PF12341_consen 3 EIEAIAAGDSWVAVATSAGYLRIFS 27 (27)
T ss_pred eEEEEEccCCEEEEEeCCCeEEecC
Confidence 57788888889999887 6999874
No 456
>KOG1900 consensus Nuclear pore complex, Nup155 component (D Nup154, sc Nup157/Nup170) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=66.36 E-value=46 Score=35.79 Aligned_cols=96 Identities=13% Similarity=0.315 Sum_probs=54.5
Q ss_pred eEEEEECCEEEEEEcCCcEEEEEEeccCCCCceE-EEeeCCC------ceEEEeecCCCCcEEEE----eeCCcceEEee
Q 020784 187 RIIVVLEQKIFVYNFADLKLLHQIETIANPKGLC-AVSQGVG------SLVLVCPGLQKGQVRVE----HYASKRTKFIM 255 (321)
Q Consensus 187 ~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~-~~s~~~d------~~~la~sGs~dg~V~i~----d~~~~~~~~l~ 255 (321)
+..+..|+.+.+|+..++.....+++-.+.+..+ -+-|.++ ..+|++ +..- .|.|+ +-.+.....+.
T Consensus 92 RaWiTiDn~L~lWny~~~~e~~~~d~~shtIl~V~LvkPkpgvFv~~IqhlLvv-aT~~-ei~ilgV~~~~~~~~~~~f~ 169 (1311)
T KOG1900|consen 92 RAWITIDNNLFLWNYESDNELAEYDGLSHTILKVGLVKPKPGVFVPEIQHLLVV-ATPV-EIVILGVSFDEFTGELSIFN 169 (1311)
T ss_pred ceEEEeCCeEEEEEcCCCCccccccchhhhheeeeeecCCCCcchhhhheeEEe-cccc-eEEEEEEEeccccCcccccc
Confidence 5667789999999998876667776654433222 2233332 112332 3322 23332 22222233333
Q ss_pred cc------ccceeEEEECCCCCEEEEEeCCCcEEEEEEc
Q 020784 256 AH------DSRIACFALTQDGQLLATSSTKGTLVRIFNT 288 (321)
Q Consensus 256 ~H------~~~V~~vafspdg~~las~S~Dgt~IrIWd~ 288 (321)
.+ ...|+|+....+|+.|.+|- ||. ||.+
T Consensus 170 ~~~~i~~dg~~V~~I~~t~nGRIF~~G~-dg~---lyEl 204 (1311)
T KOG1900|consen 170 TSFKISVDGVSVNCITYTENGRIFFAGR-DGN---LYEL 204 (1311)
T ss_pred cceeeecCCceEEEEEeccCCcEEEeec-CCC---EEEE
Confidence 33 55699999889999998765 666 4543
No 457
>COG4880 Secreted protein containing C-terminal beta-propeller domain distantly related to WD-40 repeats [General function prediction only]
Probab=66.13 E-value=1.2e+02 Score=28.75 Aligned_cols=69 Identities=17% Similarity=0.256 Sum_probs=47.2
Q ss_pred CCceeEEEEeCCeEEEEE---CCEEEEEEcCCc---EEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEE--Eee
Q 020784 175 RSEVRSVKLRRDRIIVVL---EQKIFVYNFADL---KLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRV--EHY 246 (321)
Q Consensus 175 ~~~v~~v~~~~~~~~~~~---~~~I~iwd~~~~---~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i--~d~ 246 (321)
...|+++.|.++...+++ .+-+.+.|+.+. +.+-.++- +....-+++-+++.+|.+ |..+|.|+| +|.
T Consensus 427 gERIYAvRf~gdv~yiVTfrqtDPlfviDlsNPenPkvlGeLKI---PGfS~YLHpigen~~lGv-G~~~g~vKiSLFdi 502 (603)
T COG4880 427 GERIYAVRFVGDVLYIVTFRQTDPLFVIDLSNPENPKVLGELKI---PGFSEYLHPIGENRLLGV-GAYQGGVKISLFDI 502 (603)
T ss_pred CceEEEEEEeCceEEEEEEeccCceEEEEcCCCCCCceeEEEec---CCchhhccccCCCcEEEe-ecccCCceEEEEec
Confidence 457999999999877765 357788888654 33333432 222334567777888885 999999988 665
Q ss_pred C
Q 020784 247 A 247 (321)
Q Consensus 247 ~ 247 (321)
.
T Consensus 503 S 503 (603)
T COG4880 503 S 503 (603)
T ss_pred c
Confidence 4
No 458
>KOG2109 consensus WD40 repeat protein [General function prediction only]
Probab=66.03 E-value=7.6 Score=38.34 Aligned_cols=49 Identities=31% Similarity=0.469 Sum_probs=38.6
Q ss_pred EEEEeeCCc-ceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcC
Q 020784 241 VRVEHYASK-RTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 241 V~i~d~~~~-~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~ 289 (321)
+.+-|+... ....|++|+.++..++|.+.|.+|++++..|..|.+|.+.
T Consensus 297 vivkdf~S~a~i~QfkAhkspiSaLcfdqsgsllViasi~g~nVnvfRim 346 (788)
T KOG2109|consen 297 VIVKDFDSFADIRQFKAHKSPISALCFDQSGSLLVIASITGRNVNVFRIM 346 (788)
T ss_pred EEeecccchhhhhheeeecCcccccccccCceEEEEEeeccceeeeEEec
Confidence 333444443 3568999999999999999999999999998867777654
No 459
>KOG3630 consensus Nuclear pore complex, Nup214/CAN component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=64.15 E-value=40 Score=35.79 Aligned_cols=52 Identities=13% Similarity=0.123 Sum_probs=35.5
Q ss_pred cCCCCcEEEEeeCCcc-eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEE
Q 020784 235 GLQKGQVRVEHYASKR-TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 235 Gs~dg~V~i~d~~~~~-~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd 287 (321)
...|+.|++.-+.... ..+--.-...++||+|+|.|+.++.|-..|+ +.=|-
T Consensus 174 ~l~dlsl~V~~~~~~~~~v~s~p~t~~~Tav~WSprGKQl~iG~nnGt-~vQy~ 226 (1405)
T KOG3630|consen 174 DLSDLSLRVKSTKQLAQNVTSFPVTNSQTAVLWSPRGKQLFIGRNNGT-EVQYE 226 (1405)
T ss_pred hccccchhhhhhhhhhhhhcccCcccceeeEEeccccceeeEecCCCe-EEEee
Confidence 5677888875443221 1121234567899999999999999998998 54443
No 460
>PF08801 Nucleoporin_N: Nup133 N terminal like; InterPro: IPR014908 Nucleoporins are the main components of the nuclear pore complex (NPC) in eukaryotic cells, and mediate bidirectional nucleocytoplasmic transport, especially of mRNA and proteins. RNA undergoing nuclear export first encounters the basket of the nuclear pore and many nucleoporins are accessible on the basket side of the pore [, ]. This entry represents the N-terminal of Nucleoprotein which forms a seven-bladed beta propeller structure []. ; PDB: 1XKS_A.
Probab=63.96 E-value=1.3e+02 Score=28.32 Aligned_cols=31 Identities=19% Similarity=0.376 Sum_probs=25.3
Q ss_pred cceeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 259 SRIACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 259 ~~V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
..|.+|+..+..+.|.+.+.+|+ |++|++..
T Consensus 190 ~~I~~v~~d~~r~~ly~l~~~~~-Iq~w~l~~ 220 (422)
T PF08801_consen 190 PKIVQVAVDPSRRLLYTLTSDGS-IQVWDLGP 220 (422)
T ss_dssp --EEEEEEETTTTEEEEEESSE--EEEEEE-S
T ss_pred hceeeEEecCCcCEEEEEeCCCc-EEEEEEeC
Confidence 34999999988899999999999 99999985
No 461
>PF08728 CRT10: CRT10; InterPro: IPR014839 CRT10 is a transcriptional regulator of ribonucleotide reductase (RNR) genes []. RNR catalyses the rate limiting step in dNTP synthesis. Mutations in CRT10 have been shown to enhance hydroxyurea resistance [].
Probab=63.93 E-value=1.8e+02 Score=29.76 Aligned_cols=61 Identities=18% Similarity=0.212 Sum_probs=41.1
Q ss_pred CCceEEEeecCCCCcEEEEeeCCc--ceEE--eeccccceeEEEECCCC---C---EEEEEeCCCcEEEEEEc
Q 020784 226 VGSLVLVCPGLQKGQVRVEHYASK--RTKF--IMAHDSRIACFALTQDG---Q---LLATSSTKGTLVRIFNT 288 (321)
Q Consensus 226 ~d~~~la~sGs~dg~V~i~d~~~~--~~~~--l~~H~~~V~~vafspdg---~---~las~S~Dgt~IrIWd~ 288 (321)
....+||+ ++....|.|+-+... .... -..|...|-+|+|-++. . +|+.++-.|. +-+|++
T Consensus 175 ~~~rlIAV-SsNs~~VTVFaf~l~~~r~~~~~s~~~~hNIP~VSFl~~~~d~~G~v~v~a~dI~G~-v~~~~I 245 (717)
T PF08728_consen 175 KKSRLIAV-SSNSQEVTVFAFALVDERFYHVPSHQHSHNIPNVSFLDDDLDPNGHVKVVATDISGE-VWTFKI 245 (717)
T ss_pred CcceEEEE-ecCCceEEEEEEeccccccccccccccccCCCeeEeecCCCCCccceEEEEEeccCc-EEEEEE
Confidence 55578886 777778888554431 1111 12366779999997653 2 7888999999 778887
No 462
>PF01731 Arylesterase: Arylesterase; InterPro: IPR002640 The serum paraoxonases/arylesterases are enzymes that catalyse the hydrolysis of the toxic metabolites of a variety of organophosphorus insecticides. The enzymes hydrolyse a broad spectrum of organophosphate substrates, including paraoxon and a number of aromatic carboxylic acid esters (e.g., phenyl acetate), and hence confer resistance to organophosphate toxicity []. Mammals have 3 distinct paraoxonase types, termed PON1-3 [, ]. In mice and humans, the PON genes are found on the same chromosome in close proximity. PON activity has been found in variety of tissues, with highest levels in liver and serum - the source of serum PON is thought to be the liver. Unlike mammals, fish and avian species lack paraoxonase activity. Human and rabbit PONs appear to have two distinct Ca2+ binding sites, one required for stability and one required for catalytic activity. The Ca2+ dependency of PONs suggests a mechanism of hydrolysis where Ca2+ acts as the electrophillic catalyst, like that proposed for phospholipase A2. The paraoxonase enzymes, PON1 and PON3, are high density lipoprotein (HDL)- associated proteins capable of preventing oxidative modification of low density lipoproteins (LPL) []. Although PON2 has oxidative properties, the enzyme does not associate with HDL. Within a given species, PON1, PON2 and PON3 share ~60% amino acid sequence identity, whereas between mammalian species particular PONs (1,2 or 3) share 79-90% identity at the amino acid level. Human PON1 and PON3 share numerous conserved phosphorylation and N-glycosylation sites; however, it is not known whether the PON proteins are modified at these sites, or whether modification at these sites is required for activity in vivo []. This family consists of arylesterases (Also known as serum paraoxonase) 3.1.1.2 from EC. These enzymes hydrolyse organophosphorus esters such as paraoxon and are found in the liver and blood. They confer resistance to organophosphate toxicity []. Human arylesterase (PON1) P27169 from SWISSPROT is associated with HDL and may protect against LDL oxidation [].; GO: 0004064 arylesterase activity
Probab=62.24 E-value=56 Score=23.47 Aligned_cols=30 Identities=17% Similarity=0.284 Sum_probs=22.6
Q ss_pred cceeEEEECCCCCEEEEEeC-CCcEEEEEEcC
Q 020784 259 SRIACFALTQDGQLLATSST-KGTLVRIFNTL 289 (321)
Q Consensus 259 ~~V~~vafspdg~~las~S~-Dgt~IrIWd~~ 289 (321)
...+.|+++|++++|..++. .+. |+|+...
T Consensus 54 ~~aNGI~~s~~~k~lyVa~~~~~~-I~vy~~~ 84 (86)
T PF01731_consen 54 SFANGIAISPDKKYLYVASSLAHS-IHVYKRH 84 (86)
T ss_pred CCCceEEEcCCCCEEEEEeccCCe-EEEEEec
Confidence 44688999999887766655 455 9998765
No 463
>PRK13684 Ycf48-like protein; Provisional
Probab=61.32 E-value=1.3e+02 Score=27.44 Aligned_cols=72 Identities=13% Similarity=0.137 Sum_probs=40.1
Q ss_pred eEEEeeCCCceEEEeecCCCCcEEE-EeeCCcceEEe-eccccceeEEEECCCCCEEEEEeCCCcEEEEE-EcCCCcEEE
Q 020784 219 LCAVSQGVGSLVLVCPGLQKGQVRV-EHYASKRTKFI-MAHDSRIACFALTQDGQLLATSSTKGTLVRIF-NTLDGTLLQ 295 (321)
Q Consensus 219 ~~~~s~~~d~~~la~sGs~dg~V~i-~d~~~~~~~~l-~~H~~~V~~vafspdg~~las~S~Dgt~IrIW-d~~tg~~i~ 295 (321)
..++...+++.++++ +..|.+.. ++-....-..+ ..-...++++++.++++.++.+ ..|. ++ . ....|+-..
T Consensus 175 ~~~i~~~~~g~~v~~--g~~G~i~~s~~~gg~tW~~~~~~~~~~l~~i~~~~~g~~~~vg-~~G~-~~-~~s~d~G~sW~ 249 (334)
T PRK13684 175 VRNLRRSPDGKYVAV--SSRGNFYSTWEPGQTAWTPHQRNSSRRLQSMGFQPDGNLWMLA-RGGQ-IR-FNDPDDLESWS 249 (334)
T ss_pred EEEEEECCCCeEEEE--eCCceEEEEcCCCCCeEEEeeCCCcccceeeeEcCCCCEEEEe-cCCE-EE-EccCCCCCccc
Confidence 444555566677764 44565554 33222222222 2234578999999999987765 4676 53 4 345555444
No 464
>COG5308 NUP170 Nuclear pore complex subunit [Intracellular trafficking and secretion]
Probab=60.20 E-value=65 Score=33.46 Aligned_cols=132 Identities=18% Similarity=0.208 Sum_probs=74.0
Q ss_pred CCCcEEEEeCCCCcEEEEEe-eCCceeEEEEe-C----------CeEEEEECCEEEEEEc----CCcEEEEEEecc----
Q 020784 154 PLNKVMIWDDHQSRCIGELS-FRSEVRSVKLR-R----------DRIIVVLEQKIFVYNF----ADLKLLHQIETI---- 213 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~~~~-~~~~v~~v~~~-~----------~~~~~~~~~~I~iwd~----~~~~~~~~l~~~---- 213 (321)
.|+.+.+||..++...+.+. +...|..|..- | ..+++++...+.++-+ +++++ .-|.++
T Consensus 100 ~dnkLiLWnynn~neyq~idd~shtIlkVkLvrPkantFvs~i~hlL~vAT~~e~~ilgvs~d~~T~El-s~fnTgl~vs 178 (1263)
T COG5308 100 NDNKLILWNYNNSNEYQEIDDFSHTILKVKLVRPKANTFVSRISHLLFVATEKEVMILGVSKDTKTGEL-SLFNTGLVVS 178 (1263)
T ss_pred cCCEEEEEecCCCcchhhhhhhhhheeEEEEeccCCcccHHhhhhhhhhhhhheeeEEEEEecccccee-EEEecceEEe
Confidence 57999999998765444332 33455555532 1 1355566666666654 23332 233332
Q ss_pred CCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCc------------------------c-eEEeeccccceeEEEECC
Q 020784 214 ANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASK------------------------R-TKFIMAHDSRIACFALTQ 268 (321)
Q Consensus 214 ~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~------------------------~-~~~l~~H~~~V~~vafsp 268 (321)
.+...+.++....+|.++. +|..| +.+|.+..+ + ...+.-|...|..++...
T Consensus 179 vqGinV~civs~e~GrIFf-~g~~d--~nvyEl~Y~~sd~wfnskcskiclTkS~l~sllPs~~~~~ipgetI~Ql~vDq 255 (1263)
T COG5308 179 VQGINVRCIVSEEDGRIFF-GGEND--PNVYELVYKSSDSWFNSKCSKICLTKSILSSLLPSFFSFGIPGETIKQLAVDQ 255 (1263)
T ss_pred ccCceeEEEEeccCCcEEE-ecCCC--CCeEEEEEeccchhhhhhhhccCCcHHHHHhhcccccccCCcccchhheeecc
Confidence 2223444444444778777 46666 555654311 0 012234667788888877
Q ss_pred CCCEEEEEeCCCcEEEEEEcCC
Q 020784 269 DGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 269 dg~~las~S~Dgt~IrIWd~~t 290 (321)
...+|-+-+.... ||-+.+..
T Consensus 256 sRg~ly~Lr~kS~-Vray~itk 276 (1263)
T COG5308 256 SRGLLYVLRKKSA-VRAYSITK 276 (1263)
T ss_pred cccceeeecccce-eeeEeeec
Confidence 6667777776666 87777654
No 465
>PHA03098 kelch-like protein; Provisional
Probab=60.03 E-value=1.7e+02 Score=28.42 Aligned_cols=108 Identities=9% Similarity=-0.009 Sum_probs=49.8
Q ss_pred CCCCEEEEEcCC------cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcE
Q 020784 95 QDHGCFAAGTDH------GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRC 168 (321)
Q Consensus 95 ~dg~~lasg~~~------gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~ 168 (321)
-+|++++.|+.+ .+..||..+.+........ ...........+ +.+.+.||.......-+.+-.||..+++.
T Consensus 341 ~~~~lyv~GG~~~~~~~~~v~~yd~~~~~W~~~~~lp-~~r~~~~~~~~~-~~iYv~GG~~~~~~~~~~v~~yd~~t~~W 418 (534)
T PHA03098 341 FNNRIYVIGGIYNSISLNTVESWKPGESKWREEPPLI-FPRYNPCVVNVN-NLIYVIGGISKNDELLKTVECFSLNTNKW 418 (534)
T ss_pred ECCEEEEEeCCCCCEecceEEEEcCCCCceeeCCCcC-cCCccceEEEEC-CEEEEECCcCCCCcccceEEEEeCCCCee
Confidence 367777777642 2446676655443222210 111111112223 34545554211000125688999887765
Q ss_pred EEEEeeCC--ceeEEEEeCCeEEEEEC----------CEEEEEEcCCc
Q 020784 169 IGELSFRS--EVRSVKLRRDRIIVVLE----------QKIFVYNFADL 204 (321)
Q Consensus 169 ~~~~~~~~--~v~~v~~~~~~~~~~~~----------~~I~iwd~~~~ 204 (321)
...-.... .-.++....+.+++.++ +.+.+||..+.
T Consensus 419 ~~~~~~p~~r~~~~~~~~~~~iyv~GG~~~~~~~~~~~~v~~yd~~~~ 466 (534)
T PHA03098 419 SKGSPLPISHYGGCAIYHDGKIYVIGGISYIDNIKVYNIVESYNPVTN 466 (534)
T ss_pred eecCCCCccccCceEEEECCEEEEECCccCCCCCcccceEEEecCCCC
Confidence 43221111 11233444556655532 13888888654
No 466
>TIGR02604 Piru_Ver_Nterm putative membrane-bound dehydrogenase domain. All proteins that score above the trusted cutoff score of 45 to this model are large proteins of either Pirellula sp. 1 or Verrucomicrobium spinosum. These proteins all contain, in addition to this domain, several hundred residues of highly variable sequence, and then a well-conserved C-terminal domain (TIGR02603) that features a putative cytochrome c-type heme binding motif CXXCH. The membrane-bound L-sorbosone dehydrogenase from Acetobacter liquefaciens (Gluconacetobacter liquefaciens) is homologous to this domain but lacks additional sequence regions shared by members of this family and belongs to a different clade of the larger family of homologs. It and its closely related homologs are excluded from the this model by scoring between the trusted (45) and noise (18) cutoffs.
Probab=57.29 E-value=1.6e+02 Score=27.18 Aligned_cols=57 Identities=14% Similarity=0.061 Sum_probs=33.6
Q ss_pred ccceeEEEECCCCCEEEEEeCC-------------------CcEEEEEEcCCCcEEEEEeCCCcc-eeEEEeecCceEE
Q 020784 258 DSRIACFALTQDGQLLATSSTK-------------------GTLVRIFNTLDGTLLQEECCPSIS-AQSGLWLSSAWLR 316 (321)
Q Consensus 258 ~~~V~~vafspdg~~las~S~D-------------------gt~IrIWd~~tg~~i~~~~~g~~~-~~~~~s~d~~~la 316 (321)
....+.++|.|||.+.++-+.. |. |.-+|..+++ +..+..|... ..+.+.++|+++.
T Consensus 123 ~~~~~~l~~gpDG~LYv~~G~~~~~~~~~~~~~~~~~~~~~g~-i~r~~pdg~~-~e~~a~G~rnp~Gl~~d~~G~l~~ 199 (367)
T TIGR02604 123 HHSLNSLAWGPDGWLYFNHGNTLASKVTRPGTSDESRQGLGGG-LFRYNPDGGK-LRVVAHGFQNPYGHSVDSWGDVFF 199 (367)
T ss_pred cccccCceECCCCCEEEecccCCCceeccCCCccCcccccCce-EEEEecCCCe-EEEEecCcCCCccceECCCCCEEE
Confidence 3458899999999876665521 33 3334444433 3455555543 3457777776654
No 467
>PF07995 GSDH: Glucose / Sorbosone dehydrogenase; InterPro: IPR012938 Proteins containing this domain are thought to be glucose/sorbosone dehydrogenases. The best characterised of these proteins is soluble glucose dehydrogenase (P13650 from SWISSPROT) from Acinetobacter calcoaceticus, which oxidises glucose to gluconolactone. The enzyme is a calcium-dependent homodimer which uses PQQ as a cofactor [].; GO: 0016901 oxidoreductase activity, acting on the CH-OH group of donors, quinone or similar compound as acceptor, 0048038 quinone binding, 0005975 carbohydrate metabolic process; PDB: 2ISM_A 2WG3_D 3HO5_A 3HO4_A 3HO3_A 2WFT_A 2WG4_B 2WFX_B 1CRU_A 1CQ1_B ....
Probab=56.14 E-value=76 Score=28.95 Aligned_cols=31 Identities=29% Similarity=0.552 Sum_probs=25.1
Q ss_pred ceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcE
Q 020784 260 RIACFALTQDGQLLATSSTKGTLVRIFNTLDGTL 293 (321)
Q Consensus 260 ~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~ 293 (321)
..+.|+|.|||++|++-- .|. |++++ ..|..
T Consensus 3 ~P~~~a~~pdG~l~v~e~-~G~-i~~~~-~~g~~ 33 (331)
T PF07995_consen 3 NPRSMAFLPDGRLLVAER-SGR-IWVVD-KDGSL 33 (331)
T ss_dssp SEEEEEEETTSCEEEEET-TTE-EEEEE-TTTEE
T ss_pred CceEEEEeCCCcEEEEeC-Cce-EEEEe-CCCcC
Confidence 468999999999988654 888 99998 55654
No 468
>KOG2280 consensus Vacuolar assembly/sorting protein VPS16 [Intracellular trafficking, secretion, and vesicular transport]
Probab=55.56 E-value=39 Score=34.13 Aligned_cols=89 Identities=18% Similarity=0.150 Sum_probs=55.3
Q ss_pred EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceE----EeeccccceeEEEECCCC
Q 020784 195 KIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTK----FIMAHDSRIACFALTQDG 270 (321)
Q Consensus 195 ~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~----~l~~H~~~V~~vafspdg 270 (321)
.|+||++. |+++.++.-... ..+.+.++.+..+|++ ..+|+|.++++-..... -+......|..+.|..+|
T Consensus 65 ~I~If~~s-G~lL~~~~w~~~--~lI~mgWs~~eeLI~v--~k~g~v~Vy~~~ge~ie~~svg~e~~~~~I~ec~~f~~G 139 (829)
T KOG2280|consen 65 YIRIFNIS-GQLLGRILWKHG--ELIGMGWSDDEELICV--QKDGTVHVYGLLGEFIESNSVGFESQMSDIVECRFFHNG 139 (829)
T ss_pred eEEEEecc-ccchHHHHhcCC--CeeeecccCCceEEEE--eccceEEEeecchhhhcccccccccccCceeEEEEecCc
Confidence 68888876 444444432211 4667777777788876 89999999887543322 123344557777777788
Q ss_pred CEEEEEeCCCcEEEEEEcCC
Q 020784 271 QLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 271 ~~las~S~Dgt~IrIWd~~t 290 (321)
-.+.+.+ |..+.+.++..
T Consensus 140 Vavlt~~--g~v~~i~~~~~ 157 (829)
T KOG2280|consen 140 VAVLTVS--GQVILINGVEE 157 (829)
T ss_pred eEEEecC--CcEEEEcCCCc
Confidence 7666665 33466666554
No 469
>KOG3630 consensus Nuclear pore complex, Nup214/CAN component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=55.49 E-value=1.6e+02 Score=31.57 Aligned_cols=137 Identities=12% Similarity=-0.007 Sum_probs=71.8
Q ss_pred EEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEE---E--E-----eeCC--ceeEEEEeCCe---EEEE-ECC
Q 020784 131 GVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIG---E--L-----SFRS--EVRSVKLRRDR---IIVV-LEQ 194 (321)
Q Consensus 131 ~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~---~--~-----~~~~--~v~~v~~~~~~---~~~~-~~~ 194 (321)
..+.+.++....+++... ++-.|..+|+++...-. . + .+.. -+.++.|++.. .+++ .+.
T Consensus 104 ~~~v~~~D~t~s~v~~ts-----ng~~v~~fD~~~fs~s~~~~~~pl~~s~ts~ek~vf~~~~~wnP~vp~n~av~l~dl 178 (1405)
T KOG3630|consen 104 VIFVCFHDATDSVVVSTS-----NGEAVYSFDLEEFSESRYETTVPLKNSATSFEKPVFQLKNVWNPLVPLNSAVDLSDL 178 (1405)
T ss_pred eEEEeccCCceEEEEEec-----CCceEEEEehHhhhhhhhhhccccccccchhccccccccccccCCccchhhhhcccc
Confidence 333344454444444422 33468899987654221 0 1 1112 24456677642 3333 456
Q ss_pred EEEEEEcCCc-EEEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCCcceEEeec----cccceeEEEECCC
Q 020784 195 KIFVYNFADL-KLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTKFIMA----HDSRIACFALTQD 269 (321)
Q Consensus 195 ~I~iwd~~~~-~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~~l~~----H~~~V~~vafspd 269 (321)
.|++..+... +.+.++.. .....++++.+.|..+++ |..+|++.=+.........+.. -...|.+|+|-..
T Consensus 179 sl~V~~~~~~~~~v~s~p~---t~~~Tav~WSprGKQl~i-G~nnGt~vQy~P~leik~~ip~Pp~~e~yrvl~v~Wl~t 254 (1405)
T KOG3630|consen 179 SLRVKSTKQLAQNVTSFPV---TNSQTAVLWSPRGKQLFI-GRNNGTEVQYEPSLEIKSEIPEPPVEENYRVLSVTWLST 254 (1405)
T ss_pred chhhhhhhhhhhhhcccCc---ccceeeEEeccccceeeE-ecCCCeEEEeecccceeecccCCCcCCCcceeEEEEecc
Confidence 7887766422 11222221 123445555556677775 9999988766544332222211 1467999999877
Q ss_pred CCEEEEE
Q 020784 270 GQLLATS 276 (321)
Q Consensus 270 g~~las~ 276 (321)
..+|+.-
T Consensus 255 ~eflvvy 261 (1405)
T KOG3630|consen 255 QEFLVVY 261 (1405)
T ss_pred eeEEEEe
Confidence 7777664
No 470
>COG4590 ABC-type uncharacterized transport system, permease component [General function prediction only]
Probab=54.54 E-value=78 Score=30.30 Aligned_cols=55 Identities=11% Similarity=0.160 Sum_probs=34.0
Q ss_pred CCCCcEEEEeeCCcceEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCc
Q 020784 236 LQKGQVRVEHYASKRTKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGT 292 (321)
Q Consensus 236 s~dg~V~i~d~~~~~~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~ 292 (321)
+.+|++........+..-+..--..+.-+++||++.+|++-- .|. |+++.+++..
T Consensus 335 ~~~G~L~~f~st~~~~lL~~~~~~~~~~~~~Sp~~~~Ll~e~-~gk-i~~~~l~Nr~ 389 (733)
T COG4590 335 YRNGTLQSFYSTSEKLLLFERAYQAPQLVAMSPNQAYLLSED-QGK-IRLAQLENRN 389 (733)
T ss_pred cCCCceeeeecccCcceehhhhhcCcceeeeCcccchheeec-CCc-eEEEEecCCC
Confidence 556666663322222222222223677899999999998653 455 9999988753
No 471
>COG3292 Predicted periplasmic ligand-binding sensor domain [Signal transduction mechanisms]
Probab=54.48 E-value=2.3e+02 Score=28.08 Aligned_cols=136 Identities=13% Similarity=0.161 Sum_probs=74.8
Q ss_pred cEEEEeCCCCcEEEEE-eeCC-ceeEEEEeC-CeEEEEECC-EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEE
Q 020784 157 KVMIWDDHQSRCIGEL-SFRS-EVRSVKLRR-DRIIVVLEQ-KIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLV 232 (321)
Q Consensus 157 ~v~iWD~~~~~~~~~~-~~~~-~v~~v~~~~-~~~~~~~~~-~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la 232 (321)
.+.+=+-.+|..+... +... .|+.+++.. ..+.+++.+ .+-.|+-.+.-.............++++-.++++.+.+
T Consensus 355 ~L~van~stG~~v~sv~q~Rg~nit~~~~d~~g~lWlgs~q~GLsrl~n~n~~avlde~agl~ss~V~aived~dnsLWI 434 (671)
T COG3292 355 ELMVANGSTGELVRSVHQLRGMNITTTLEDSRGRLWLGSMQNGLSRLDNKNEWAVLDEDAGLPSSEVSAIVEDPDNSLWI 434 (671)
T ss_pred eEEEecCCCCcEEEEeeeccccccchhhhccCCcEEEEecccchhhhccCCcccccccccCCcccceeeeeecCCCCEEE
Confidence 3444455555544432 2222 344444443 356666543 67777766522222222222234578888999988665
Q ss_pred eecCCCCcEEEEeeCCcce--EEeecc---ccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEEE
Q 020784 233 CPGLQKGQVRVEHYASKRT--KFIMAH---DSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQEE 297 (321)
Q Consensus 233 ~sGs~dg~V~i~d~~~~~~--~~l~~H---~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~~ 297 (321)
|+.+|.++..--..+.. ..+..| .+.|..+.+-++|++-+..+ +| |..|+-+.......+
T Consensus 435 --GTs~Glvk~~pe~~~v~n~ln~~~~~l~~s~~~~lg~~~~g~Lw~a~g-~g--va~~~sq~~~~~~~l 499 (671)
T COG3292 435 --GTSGGLVKRDPESGRVLNLLNPGSHGLDGSRVEQLGLGPDGRLWLAAG-SG--VAAWESQRRMFVPIL 499 (671)
T ss_pred --eccCCeEecCccccchhcccccccCcCCcchhhhhccCCCCceEEEec-ce--eeeeccccceecccc
Confidence 89998887632111111 122222 45588899999998644332 32 788988765555444
No 472
>PRK13684 Ycf48-like protein; Provisional
Probab=53.88 E-value=1.8e+02 Score=26.60 Aligned_cols=149 Identities=9% Similarity=-0.019 Sum_probs=67.5
Q ss_pred CCeEEEEEcCCCCEEEEEcCCcEEEEEecCCceeEEeeee-cCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCC
Q 020784 86 PTLLHISFNQDHGCFAAGTDHGFRIYNCDPFREIFRRDFE-RGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDH 164 (321)
Q Consensus 86 ~~V~~v~fs~dg~~lasg~~~gv~vw~~~~~~~~~~~~~~-~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~ 164 (321)
..+.++.+.+++.++++|....+ +-..+.+...+..... ....+..+.+..++..+++.. .+.+++=..+
T Consensus 173 g~~~~i~~~~~g~~v~~g~~G~i-~~s~~~gg~tW~~~~~~~~~~l~~i~~~~~g~~~~vg~--------~G~~~~~s~d 243 (334)
T PRK13684 173 GVVRNLRRSPDGKYVAVSSRGNF-YSTWEPGQTAWTPHQRNSSRRLQSMGFQPDGNLWMLAR--------GGQIRFNDPD 243 (334)
T ss_pred ceEEEEEECCCCeEEEEeCCceE-EEEcCCCCCeEEEeeCCCcccceeeeEcCCCCEEEEec--------CCEEEEccCC
Confidence 47899999999988877766443 2222233222221110 134556666666666554433 2434321223
Q ss_pred CCcEEEEEeeC-----CceeEEEEeCC-eEEEEECCEEEEEEcCCcEEEEEEeccC-CCCceEEEeeCCCceEEEeecCC
Q 020784 165 QSRCIGELSFR-----SEVRSVKLRRD-RIIVVLEQKIFVYNFADLKLLHQIETIA-NPKGLCAVSQGVGSLVLVCPGLQ 237 (321)
Q Consensus 165 ~~~~~~~~~~~-----~~v~~v~~~~~-~~~~~~~~~I~iwd~~~~~~~~~l~~~~-~~~~~~~~s~~~d~~~la~sGs~ 237 (321)
.|..-...... ..+.++.+.++ .++++...-..+.....++..+.+.... -+.....+....++..+++ +.
T Consensus 244 ~G~sW~~~~~~~~~~~~~l~~v~~~~~~~~~~~G~~G~v~~S~d~G~tW~~~~~~~~~~~~~~~~~~~~~~~~~~~--G~ 321 (334)
T PRK13684 244 DLESWSKPIIPEITNGYGYLDLAYRTPGEIWAGGGNGTLLVSKDGGKTWEKDPVGEEVPSNFYKIVFLDPEKGFVL--GQ 321 (334)
T ss_pred CCCccccccCCccccccceeeEEEcCCCCEEEEcCCCeEEEeCCCCCCCeECCcCCCCCcceEEEEEeCCCceEEE--CC
Confidence 33221111111 24666777654 4555544333334444444443332211 1112222222223355553 45
Q ss_pred CCcEEEEe
Q 020784 238 KGQVRVEH 245 (321)
Q Consensus 238 dg~V~i~d 245 (321)
.|.|.-++
T Consensus 322 ~G~il~~~ 329 (334)
T PRK13684 322 RGVLLRYV 329 (334)
T ss_pred CceEEEec
Confidence 56665543
No 473
>KOG1898 consensus Splicing factor 3b, subunit 3 [RNA processing and modification]
Probab=53.48 E-value=3.1e+02 Score=29.30 Aligned_cols=87 Identities=13% Similarity=0.096 Sum_probs=50.9
Q ss_pred CcEEEEeCCCCcEEEEEee---CCceeEEEEeCCeEEEEEC-CEEEEE--EcCCcEEEEEEeccCCCCceEEEeeCCCce
Q 020784 156 NKVMIWDDHQSRCIGELSF---RSEVRSVKLRRDRIIVVLE-QKIFVY--NFADLKLLHQIETIANPKGLCAVSQGVGSL 229 (321)
Q Consensus 156 ~~v~iWD~~~~~~~~~~~~---~~~v~~v~~~~~~~~~~~~-~~I~iw--d~~~~~~~~~l~~~~~~~~~~~~s~~~d~~ 229 (321)
+.+++||+-+.+.++.+.. ...|..+++...+++++.. ..+.++ +-...+ +..|-...-+..+.+...-.. .
T Consensus 954 ~~l~~YdlG~K~lLRk~e~k~~p~~Is~iqt~~~RI~VgD~qeSV~~~~y~~~~n~-l~~fadD~~pR~Vt~~~~lD~-~ 1031 (1205)
T KOG1898|consen 954 RFLRLYDLGKKKLLRKCELKFIPNRISSIQTYGARIVVGDIQESVHFVRYRREDNQ-LIVFADDPVPRHVTALELLDY-D 1031 (1205)
T ss_pred cEEEEeeCChHHHHhhhhhccCceEEEEEeecceEEEEeeccceEEEEEEecCCCe-EEEEeCCCccceeeEEEEecC-C
Confidence 7899999988776654433 4578889999999998864 355544 444444 445544333333333322212 3
Q ss_pred EEEeecCCCCcEEEEe
Q 020784 230 VLVCPGLQKGQVRVEH 245 (321)
Q Consensus 230 ~la~sGs~dg~V~i~d 245 (321)
.+|. ++.=|.+.+..
T Consensus 1032 tvag-aDrfGNi~~vR 1046 (1205)
T KOG1898|consen 1032 TVAG-ADRFGNIAVVR 1046 (1205)
T ss_pred ceee-ccccCcEEEEE
Confidence 3442 56566665543
No 474
>PLN00033 photosystem II stability/assembly factor; Provisional
Probab=53.44 E-value=2e+02 Score=27.12 Aligned_cols=104 Identities=9% Similarity=-0.003 Sum_probs=56.9
Q ss_pred CCceeEEEEeCC-eEEEEECCEEEEEEcCCcE-----EEEEEeccCCCCceEEEeeCCCceEEEeecCCCCcEEEEeeCC
Q 020784 175 RSEVRSVKLRRD-RIIVVLEQKIFVYNFADLK-----LLHQIETIANPKGLCAVSQGVGSLVLVCPGLQKGQVRVEHYAS 248 (321)
Q Consensus 175 ~~~v~~v~~~~~-~~~~~~~~~I~iwd~~~~~-----~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~dg~V~i~d~~~ 248 (321)
...+.++.+..+ .+++++.+.-.++....++ .+..+........+.++.+..++..+++ +.+|.+....-..
T Consensus 280 ~~~l~~v~~~~dg~l~l~g~~G~l~~S~d~G~~~~~~~f~~~~~~~~~~~l~~v~~~~d~~~~a~--G~~G~v~~s~D~G 357 (398)
T PLN00033 280 ARRIQNMGWRADGGLWLLTRGGGLYVSKGTGLTEEDFDFEEADIKSRGFGILDVGYRSKKEAWAA--GGSGILLRSTDGG 357 (398)
T ss_pred ccceeeeeEcCCCCEEEEeCCceEEEecCCCCcccccceeecccCCCCcceEEEEEcCCCcEEEE--ECCCcEEEeCCCC
Confidence 345777777654 4555555433444444443 2222222222234566666667677764 5567777643222
Q ss_pred cceEEe---eccccceeEEEECCCCCEEEEEeCCCc
Q 020784 249 KRTKFI---MAHDSRIACFALTQDGQLLATSSTKGT 281 (321)
Q Consensus 249 ~~~~~l---~~H~~~V~~vafspdg~~las~S~Dgt 281 (321)
+.-... ..-....+.+.|.++++.+|+|. +|.
T Consensus 358 ~tW~~~~~~~~~~~~ly~v~f~~~~~g~~~G~-~G~ 392 (398)
T PLN00033 358 KSWKRDKGADNIAANLYSVKFFDDKKGFVLGN-DGV 392 (398)
T ss_pred cceeEccccCCCCcceeEEEEcCCCceEEEeC-CcE
Confidence 221111 22345688999988888888764 777
No 475
>PF09826 Beta_propel: Beta propeller domain; InterPro: IPR019198 This entry consists of predicted secreted proteins containing a C-terminal beta-propeller domain distantly related to WD-40 repeats.
Probab=53.13 E-value=1.3e+02 Score=29.49 Aligned_cols=48 Identities=15% Similarity=0.289 Sum_probs=37.2
Q ss_pred cCCCeEEEEeCCCCCCCCCCcEEEEeC---CCCcEEEEEeeCCceeEEEEeCCeEEEEE
Q 020784 137 FRCNILALVGGGPDPQYPLNKVMIWDD---HQSRCIGELSFRSEVRSVKLRRDRIIVVL 192 (321)
Q Consensus 137 ~~~~~~~~~sg~~~~~~~d~~v~iWD~---~~~~~~~~~~~~~~v~~v~~~~~~~~~~~ 192 (321)
-+++.+.++. ++.|.|+|. .+.+.+..+.+...+..+-++.+++++.+
T Consensus 20 TDG~yIY~v~--------~~~l~Iida~p~~~~~~~s~I~~~~~~~eLyl~gdrLvVi~ 70 (521)
T PF09826_consen 20 TDGEYIYVVS--------GGRLYIIDAYPAEEMKVVSRIDLDGSPQELYLDGDRLVVIG 70 (521)
T ss_pred ECCCEEEEEe--------CCEEEEEECCCchhceEEEEEecCCChhheEEcCCEEEEEE
Confidence 3677777776 478999998 45667788888877888888888877765
No 476
>PF05308 Mito_fiss_reg: Mitochondrial fission regulator; InterPro: IPR007972 This family consists of several uncharacterised eukaryotic proteins of unknown function.
Probab=51.79 E-value=16 Score=32.06 Aligned_cols=6 Identities=17% Similarity=0.141 Sum_probs=2.4
Q ss_pred ccchhh
Q 020784 36 DQTDQL 41 (321)
Q Consensus 36 ~~~~~~ 41 (321)
+..++.
T Consensus 211 ~li~e~ 216 (253)
T PF05308_consen 211 DLIKER 216 (253)
T ss_pred HHHHHH
Confidence 443433
No 477
>PF14761 HPS3_N: Hermansky-Pudlak syndrome 3
Probab=49.64 E-value=1.7e+02 Score=25.06 Aligned_cols=62 Identities=13% Similarity=0.133 Sum_probs=37.4
Q ss_pred EEEEEcCCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEE
Q 020784 99 CFAAGTDHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIW 161 (321)
Q Consensus 99 ~lasg~~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iW 161 (321)
+|++.+...|.+|++...+......|..-+.+..+..+..++++++.-.... .....-+|+|
T Consensus 31 Lfva~~g~~Vev~~l~~~~~~~~~~F~Tv~~V~~l~y~~~GDYlvTlE~k~~-~~~~~fvR~Y 92 (215)
T PF14761_consen 31 LFVAASGCKVEVYDLEQEECPLLCTFSTVGRVLQLVYSEAGDYLVTLEEKNK-RSPVDFVRAY 92 (215)
T ss_pred EEEEcCCCEEEEEEcccCCCceeEEEcchhheeEEEeccccceEEEEEeecC-CccceEEEEE
Confidence 4444445568899998555444444534567777777788999988864321 0011256776
No 478
>COG1770 PtrB Protease II [Amino acid transport and metabolism]
Probab=48.52 E-value=3e+02 Score=27.75 Aligned_cols=200 Identities=11% Similarity=0.065 Sum_probs=101.1
Q ss_pred CeEEEEEcCCCCEEEEEcC-C-----cEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEE
Q 020784 87 TLLHISFNQDHGCFAAGTD-H-----GFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMI 160 (321)
Q Consensus 87 ~V~~v~fs~dg~~lasg~~-~-----gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~i 160 (321)
.+-.++.+||++++|-+-+ . +++|-|+.++.....-. .+.....+|..+++.+.-..-... -..-+|
T Consensus 130 ~Lg~~~~s~D~~~la~s~D~~G~e~y~lr~kdL~tg~~~~d~i---~~~~~~~~Wa~d~~~lfYt~~d~~----~rp~kv 202 (682)
T COG1770 130 SLGAASISPDHNLLAYSVDVLGDEQYTLRFKDLATGEELPDEI---TNTSGSFAWAADGKTLFYTRLDEN----HRPDKV 202 (682)
T ss_pred eeeeeeeCCCCceEEEEEecccccEEEEEEEecccccccchhh---cccccceEEecCCCeEEEEEEcCC----CCcceE
Confidence 5677889999999985544 2 36788888876543222 234566778888887766653321 133455
Q ss_pred EeCCCCc----EEEEEeeCCceeEEEE----eCCeEEEEE-C---CEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCc
Q 020784 161 WDDHQSR----CIGELSFRSEVRSVKL----RRDRIIVVL-E---QKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGS 228 (321)
Q Consensus 161 WD~~~~~----~~~~~~~~~~v~~v~~----~~~~~~~~~-~---~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~ 228 (321)
|--.-+. -...++....-.-+.+ +.+.+++.. + ..+++.+.......-.+-.......-..+...+|.
T Consensus 203 ~~h~~gt~~~~d~lvyeE~d~~f~~~v~~s~s~~yi~i~~~~~~tsE~~ll~a~~p~~~p~vv~pr~~g~eY~~eh~~d~ 282 (682)
T COG1770 203 WRHRLGTPGSSDELVYEEKDDRFFLSVGRSRSEAYIVISLGSHITSEVRLLDADDPEAEPKVVLPRENGVEYSVEHGGDR 282 (682)
T ss_pred EEEecCCCCCcceEEEEcCCCcEEEEeeeccCCceEEEEcCCCcceeEEEEecCCCCCceEEEEEcCCCcEEeeeecCcE
Confidence 5322211 1111222222222222 223444443 2 47888887654332222111111111222222333
Q ss_pred eEEEeecCCCC-cEEEEeeCC----cceEEeeccccceeEEEECCCCCEEEEE-eCCC-cEEEEEEcCCCcEEE
Q 020784 229 LVLVCPGLQKG-QVRVEHYAS----KRTKFIMAHDSRIACFALTQDGQLLATS-STKG-TLVRIFNTLDGTLLQ 295 (321)
Q Consensus 229 ~~la~sGs~dg-~V~i~d~~~----~~~~~l~~H~~~V~~vafspdg~~las~-S~Dg-t~IrIWd~~tg~~i~ 295 (321)
.++. ...+| ..+|..... ..-..+-.|...++--.|+--..+|+-. ..+| ..|+|++.++|+...
T Consensus 283 f~i~--sN~~gknf~l~~ap~~~~~~~w~~~I~h~~~~~l~~~~~f~~~lVl~eR~~glp~v~v~~~~~~~~~~ 354 (682)
T COG1770 283 FYIL--SNADGKNFKLVRAPVSADKSNWRELIPHREDVRLEGVDLFADHLVLLERQEGLPRVVVRDRKTGEERG 354 (682)
T ss_pred EEEE--ecCCCcceEEEEccCCCChhcCeeeeccCCCceeeeeeeeccEEEEEecccCCceEEEEecCCCceee
Confidence 3333 34444 555533221 1123667788888777777555555544 3333 237888988877643
No 479
>TIGR02608 delta_60_rpt delta-60 repeat domain. This domain occurs in tandem repeats, as many as 13, in proteins from Bdellovibrio bacteriovorus, Azotobacter vinelandii, Geobacter sulfurreducens, Pirellula sp. 1, Myxococcus xanthus, and others, many of which are Deltaproteobacteria. The periodicity of the repeat ranges from about 57 to 61 amino acids, and a core region of about 54 is represented by this model and seed alignment.
Probab=48.26 E-value=58 Score=21.21 Aligned_cols=19 Identities=26% Similarity=0.448 Sum_probs=15.6
Q ss_pred ceeEEEECCCCCEEEEEeC
Q 020784 260 RIACFALTQDGQLLATSST 278 (321)
Q Consensus 260 ~V~~vafspdg~~las~S~ 278 (321)
.++++++.|||++|+.|..
T Consensus 2 ~~~~~~~q~DGkIlv~G~~ 20 (55)
T TIGR02608 2 RAYAVAVQSDGKILVAGYV 20 (55)
T ss_pred ceEEEEECCCCcEEEEEEe
Confidence 4678899999999998853
No 480
>KOG3616 consensus Selective LIM binding factor [Transcription]
Probab=47.46 E-value=1.2e+02 Score=31.00 Aligned_cols=64 Identities=3% Similarity=0.040 Sum_probs=42.7
Q ss_pred eEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEEEEeeCCceeEEEEeCCeEEEEEC-CEEEEEE
Q 020784 130 IGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIGELSFRSEVRSVKLRRDRIIVVLE-QKIFVYN 200 (321)
Q Consensus 130 v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~-~~I~iwd 200 (321)
+..+..++.+..++++. .|+.|++++.........+....+...+.|.+.+++++++ ..+.-|.
T Consensus 17 ~~aiqshp~~~s~v~~~-------~d~si~lfn~~~r~qski~~~~~p~~nlv~tnhgl~~~tsdrr~la~~ 81 (1636)
T KOG3616|consen 17 TTAIQSHPGGQSFVLAH-------QDGSIILFNFIPRRQSKICEEAKPKENLVFTNHGLVTATSDRRALAWK 81 (1636)
T ss_pred eeeeeecCCCceEEEEe-------cCCcEEEEeecccchhhhhhhcCCccceeeeccceEEEeccchhheee
Confidence 44445566677777766 7899999998766554444555566677777777777754 4566664
No 481
>KOG3616 consensus Selective LIM binding factor [Transcription]
Probab=46.17 E-value=42 Score=34.11 Aligned_cols=35 Identities=17% Similarity=0.282 Sum_probs=29.3
Q ss_pred ccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcE
Q 020784 258 DSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTL 293 (321)
Q Consensus 258 ~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~ 293 (321)
..-+++|.-+|.|+.++.++.||+ |++|++.....
T Consensus 14 ~e~~~aiqshp~~~s~v~~~~d~s-i~lfn~~~r~q 48 (1636)
T KOG3616|consen 14 DEFTTAIQSHPGGQSFVLAHQDGS-IILFNFIPRRQ 48 (1636)
T ss_pred cceeeeeeecCCCceEEEEecCCc-EEEEeecccch
Confidence 345677887899999999999999 99999877554
No 482
>PF10214 Rrn6: RNA polymerase I-specific transcription-initiation factor; InterPro: IPR019350 RNA polymerase I-specific transcription-initiation factor Rrn6 and Rrn7 represent components of a multisubunit transcription factor essential for the initiation of rDNA transcription by Pol I []. These proteins are found in fungi.
Probab=45.02 E-value=3.7e+02 Score=27.79 Aligned_cols=116 Identities=13% Similarity=0.064 Sum_probs=65.2
Q ss_pred eCCceeEEEEe---C------CeEEEEECCEEEEEEc------C---------CcEEEEEEec---cCCCCceEEEeeCC
Q 020784 174 FRSEVRSVKLR---R------DRIIVVLEQKIFVYNF------A---------DLKLLHQIET---IANPKGLCAVSQGV 226 (321)
Q Consensus 174 ~~~~v~~v~~~---~------~~~~~~~~~~I~iwd~------~---------~~~~~~~l~~---~~~~~~~~~~s~~~ 226 (321)
...+|..|+|. . ..++|-+...+.|+.. . ....+..+.. ...+..-++|+|..
T Consensus 78 ~~~PI~qI~fa~~~~~~~~~~~~l~Vrt~~st~I~~p~~~~~~~~~~~~~s~i~~~~l~~i~~~~tgg~~~aDv~FnP~~ 157 (765)
T PF10214_consen 78 DGSPIKQIKFATLSESFDEKSRWLAVRTETSTTILRPEYHRVISSIRSRPSRIDPNPLLTISSSDTGGFPHADVAFNPWD 157 (765)
T ss_pred CCCCeeEEEecccccccCCcCcEEEEEcCCEEEEEEcccccccccccCCccccccceeEEechhhcCCCccceEEeccCc
Confidence 44456666654 1 2344556667777761 1 1133444432 22333445666554
Q ss_pred CceEEEeecCCCCcEEEEeeCC------cceEEeeccccce----------eEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 227 GSLVLVCPGLQKGQVRVEHYAS------KRTKFIMAHDSRI----------ACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 227 d~~~la~sGs~dg~V~i~d~~~------~~~~~l~~H~~~V----------~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
..++.+ -+..|.-.||++.. ..+.....+.+.+ ..|.|.++...|+.++ ... +.++|+.+
T Consensus 158 ~~q~Ai--VD~~G~Wsvw~i~~~~~~~~~~~~~~~~~~gsi~~d~~e~s~w~rI~W~~~~~~lLv~~-r~~-l~~~d~~~ 233 (765)
T PF10214_consen 158 QRQFAI--VDEKGNWSVWDIKGRPKRKSSNLRLSRNISGSIIFDPEELSNWKRILWVSDSNRLLVCN-RSK-LMLIDFES 233 (765)
T ss_pred cceEEE--EeccCcEEEEEeccccccCCcceeeccCCCccccCCCcccCcceeeEecCCCCEEEEEc-CCc-eEEEECCC
Confidence 444444 48889999999921 1121222222322 3788988877777775 444 88999998
Q ss_pred CcE
Q 020784 291 GTL 293 (321)
Q Consensus 291 g~~ 293 (321)
...
T Consensus 234 ~~~ 236 (765)
T PF10214_consen 234 NWQ 236 (765)
T ss_pred CCc
Confidence 765
No 483
>KOG2714 consensus SETA binding protein SB1 and related proteins, contain BTB/POZ domain [General function prediction only]
Probab=44.95 E-value=1.5e+02 Score=28.04 Aligned_cols=108 Identities=17% Similarity=0.263 Sum_probs=54.0
Q ss_pred CCCcEEEEeCCCCcEEEEEeeC-----CceeEEEEeCC-eEEE-EE--------CCEEEEEEcCCcEEEEEEeccCCCCc
Q 020784 154 PLNKVMIWDDHQSRCIGELSFR-----SEVRSVKLRRD-RIIV-VL--------EQKIFVYNFADLKLLHQIETIANPKG 218 (321)
Q Consensus 154 ~d~~v~iWD~~~~~~~~~~~~~-----~~v~~v~~~~~-~~~~-~~--------~~~I~iwd~~~~~~~~~l~~~~~~~~ 218 (321)
.-+.|-+|+..+++.+..+... .....+.|.+. .+++ .+ .+.|++||.+....
T Consensus 243 ~~~~Igvw~~~t~q~~d~~~~s~~dsag~~~kL~w~ng~~~li~~~~fp~~~kdN~~i~~~d~Rd~n~------------ 310 (465)
T KOG2714|consen 243 SVGKIGVWHAVTQQAQDVQPISSYDSAGSFLKLGWLNGSNLLIDSQKFPLRMKDNDLIVTEDFRDRNT------------ 310 (465)
T ss_pred ccccccccchhhhceeeeeeccCccccCChhhhccccCceeEEEEeeccccccCCceEEEeeccCCCc------------
Confidence 3478999998887443322211 12233445432 2222 21 25899999876430
Q ss_pred eEEEeeCCCceEEEeecCCCCcEEEEeeCC-----cc--eEEeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCC
Q 020784 219 LCAVSQGVGSLVLVCPGLQKGQVRVEHYAS-----KR--TKFIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLD 290 (321)
Q Consensus 219 ~~~~s~~~d~~~la~sGs~dg~V~i~d~~~-----~~--~~~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~t 290 (321)
..++ ..+++ |+..|.+++.+... +. ..++..|.++ =| |+.-..++..+|+|++..
T Consensus 311 --~~~W----~~i~~-gt~~~~vrv~~~~~~~~~~~~~l~~~f~~~~~~--------L~--~idv~~~~~~~~~~~~tr 372 (465)
T KOG2714|consen 311 --SGNW----IEIAY-GTSSGEVRVIDQHPETVGVGPCLFQTFEVHGSP--------LG--LIDVCSDGGHVRVWNSTR 372 (465)
T ss_pred --cceE----EEecC-CccccceEeeeccccccCCCCeEEEEEEecCCC--------cc--eeehhhhCCcceEEeecc
Confidence 0112 33443 66667777744321 11 2245555554 11 444444444477777653
No 484
>COG5308 NUP170 Nuclear pore complex subunit [Intracellular trafficking and secretion]
Probab=44.68 E-value=83 Score=32.71 Aligned_cols=97 Identities=11% Similarity=0.279 Sum_probs=55.1
Q ss_pred eEEEEECCEEEEEEcCCcEEEEEEeccCCCCc-eEEEeeCCC-------ceEEEeecCCCCcEEE----EeeCCcceEEe
Q 020784 187 RIIVVLEQKIFVYNFADLKLLHQIETIANPKG-LCAVSQGVG-------SLVLVCPGLQKGQVRV----EHYASKRTKFI 254 (321)
Q Consensus 187 ~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~-~~~~s~~~d-------~~~la~sGs~dg~V~i----~d~~~~~~~~l 254 (321)
+..+..|+++.+||..+.+..+.+....+.+. +.-+-|.++ +.++++ .. ..+.+ .|-.++.+..+
T Consensus 95 rcWiT~dnkLiLWnynn~neyq~idd~shtIlkVkLvrPkantFvs~i~hlL~vA-T~--~e~~ilgvs~d~~T~Els~f 171 (1263)
T COG5308 95 RCWITNDNKLILWNYNNSNEYQEIDDFSHTILKVKLVRPKANTFVSRISHLLFVA-TE--KEVMILGVSKDTKTGELSLF 171 (1263)
T ss_pred ceEEEcCCEEEEEecCCCcchhhhhhhhhheeEEEEeccCCcccHHhhhhhhhhh-hh--heeeEEEEEeccccceeEEE
Confidence 45566789999999987665555544333222 222333332 122221 22 23333 33334444444
Q ss_pred ecc------ccceeEEEECCCCCEEEEEeCCCcEEEEEEcC
Q 020784 255 MAH------DSRIACFALTQDGQLLATSSTKGTLVRIFNTL 289 (321)
Q Consensus 255 ~~H------~~~V~~vafspdg~~las~S~Dgt~IrIWd~~ 289 (321)
.-| .-.|+|+.-+.+|+.|.+|-.| +.||.+.
T Consensus 172 nTgl~vsvqGinV~civs~e~GrIFf~g~~d---~nvyEl~ 209 (1263)
T COG5308 172 NTGLVVSVQGINVRCIVSEEDGRIFFGGEND---PNVYELV 209 (1263)
T ss_pred ecceEEeccCceeEEEEeccCCcEEEecCCC---CCeEEEE
Confidence 332 3468899888899999998777 4578754
No 485
>PRK12634 flgD flagellar basal body rod modification protein; Reviewed
Probab=44.59 E-value=1.4e+02 Score=25.58 Aligned_cols=19 Identities=16% Similarity=0.356 Sum_probs=13.4
Q ss_pred ccceeEEEECCCCCEEEEE
Q 020784 258 DSRIACFALTQDGQLLATS 276 (321)
Q Consensus 258 ~~~V~~vafspdg~~las~ 276 (321)
.+.|.+|.|..+|.+|-.+
T Consensus 189 ~g~V~~V~~~~~g~~L~l~ 207 (221)
T PRK12634 189 QAPVDSVTIGSDGLYLNLT 207 (221)
T ss_pred EEEEEEEEecCCceEEEec
Confidence 4579999998767655443
No 486
>KOG2883 consensus NIPSNAP1 protein [Function unknown]
Probab=44.09 E-value=12 Score=31.68 Aligned_cols=26 Identities=35% Similarity=0.603 Sum_probs=20.7
Q ss_pred ccccCCCCCCCCCCCCCCCCCCCCccCCCCcccchhhhccccccC
Q 020784 5 SAYSSPWPEPTPDPNPNPNPNSNTSCGVSSEDQTDQLQSLESFSS 49 (321)
Q Consensus 5 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 49 (321)
--|-|+|+||-|+|+|+ +|+.++|.-
T Consensus 136 ll~fs~W~epe~r~g~n-------------------vYELrsy~l 161 (253)
T KOG2883|consen 136 LLYFSYWSEPEKRPGEN-------------------VYELRSYQL 161 (253)
T ss_pred eeeeeccCCcCCCCCCC-------------------ceeeeeEec
Confidence 45789999999988875 688888753
No 487
>PF12768 Rax2: Cortical protein marker for cell polarity
Probab=43.53 E-value=61 Score=28.93 Aligned_cols=53 Identities=8% Similarity=0.051 Sum_probs=37.0
Q ss_pred CcEEEEeeCCcceEE-eeccccceeEEEECCCCCEEEEEe------CCCcEEEEEEcCCCc
Q 020784 239 GQVRVEHYASKRTKF-IMAHDSRIACFALTQDGQLLATSS------TKGTLVRIFNTLDGT 292 (321)
Q Consensus 239 g~V~i~d~~~~~~~~-l~~H~~~V~~vafspdg~~las~S------~Dgt~IrIWd~~tg~ 292 (321)
..|++||....+=.. -.+-.+.|+.|.|..+.+++|.|. .... +..||+.+..
T Consensus 16 ~~lC~yd~~~~qW~~~g~~i~G~V~~l~~~~~~~Llv~G~ft~~~~~~~~-la~yd~~~~~ 75 (281)
T PF12768_consen 16 PGLCLYDTDNSQWSSPGNGISGTVTDLQWASNNQLLVGGNFTLNGTNSSN-LATYDFKNQT 75 (281)
T ss_pred CEEEEEECCCCEeecCCCCceEEEEEEEEecCCEEEEEEeeEECCCCcee-EEEEecCCCe
Confidence 368888877665332 234567899999987777888775 2334 8889888754
No 488
>PHA02790 Kelch-like protein; Provisional
Probab=43.52 E-value=3.1e+02 Score=26.44 Aligned_cols=105 Identities=7% Similarity=-0.070 Sum_probs=50.5
Q ss_pred cCCCCEEEEEcC---CcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEEE
Q 020784 94 NQDHGCFAAGTD---HGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCIG 170 (321)
Q Consensus 94 s~dg~~lasg~~---~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~~ 170 (321)
.-+|.+.+.|+. +.+..||..+.+......+. ...........++. +.++||... ....+-.||.++.+...
T Consensus 316 ~~~~~iYviGG~~~~~sve~ydp~~n~W~~~~~l~-~~r~~~~~~~~~g~-IYviGG~~~---~~~~ve~ydp~~~~W~~ 390 (480)
T PHA02790 316 PANNKLYVVGGLPNPTSVERWFHGDAAWVNMPSLL-KPRCNPAVASINNV-IYVIGGHSE---TDTTTEYLLPNHDQWQF 390 (480)
T ss_pred EECCEEEEECCcCCCCceEEEECCCCeEEECCCCC-CCCcccEEEEECCE-EEEecCcCC---CCccEEEEeCCCCEEEe
Confidence 346777777775 23567776554433222221 11111122223444 444444322 23568889988776543
Q ss_pred EEeeCC--ceeEEEEeCCeEEEEECCEEEEEEcCCc
Q 020784 171 ELSFRS--EVRSVKLRRDRIIVVLEQKIFVYNFADL 204 (321)
Q Consensus 171 ~~~~~~--~v~~v~~~~~~~~~~~~~~I~iwd~~~~ 204 (321)
.-.... .-.++....+.+++.+ +.+.+||..+.
T Consensus 391 ~~~m~~~r~~~~~~~~~~~IYv~G-G~~e~ydp~~~ 425 (480)
T PHA02790 391 GPSTYYPHYKSCALVFGRRLFLVG-RNAEFYCESSN 425 (480)
T ss_pred CCCCCCccccceEEEECCEEEEEC-CceEEecCCCC
Confidence 211111 1113334455555554 45677887643
No 489
>TIGR03606 non_repeat_PQQ dehydrogenase, PQQ-dependent, s-GDH family. PQQ, or pyrroloquinoline-quinone, serves as a cofactor for a number of sugar and alcohol dehydrogenases in a limited number of bacterial species. Most characterized PQQ-dependent enzymes have multiple repeats of a sequence region described by pfam01011 (PQQ enzyme repeat), but this protein family in unusual in lacking that repeat. Below the noise cutoff are related proteins mostly from species that lack PQQ biosynthesis.
Probab=43.11 E-value=3.1e+02 Score=26.38 Aligned_cols=19 Identities=37% Similarity=0.531 Sum_probs=13.4
Q ss_pred ccccceeEEEECCCCCEEEE
Q 020784 256 AHDSRIACFALTQDGQLLAT 275 (321)
Q Consensus 256 ~H~~~V~~vafspdg~~las 275 (321)
+|.+ ...++|+|+|++.++
T Consensus 228 G~RN-p~Gla~dp~G~Lw~~ 246 (454)
T TIGR03606 228 GHRN-PQGLAFTPDGTLYAS 246 (454)
T ss_pred eccc-cceeEECCCCCEEEE
Confidence 4544 457899998887765
No 490
>PRK10115 protease 2; Provisional
Probab=42.35 E-value=3.9e+02 Score=27.25 Aligned_cols=196 Identities=11% Similarity=0.026 Sum_probs=91.1
Q ss_pred EEEEEcCCCCEEEEEcC-C------cEEEEEecCC--ceeEEeeeecCCceEEEEE-ecCCCeEEEEeCCCCCCCCCCcE
Q 020784 89 LHISFNQDHGCFAAGTD-H------GFRIYNCDPF--REIFRRDFERGGGIGVVEM-LFRCNILALVGGGPDPQYPLNKV 158 (321)
Q Consensus 89 ~~v~fs~dg~~lasg~~-~------gv~vw~~~~~--~~~~~~~~~~~~~v~~v~~-~~~~~~~~~~sg~~~~~~~d~~v 158 (321)
..++|.+||+.|+-... + .+..+++.+. +.....+. .++......+ ..++..+.+.+.+. .++.+
T Consensus 175 ~~~~w~~D~~~~~y~~~~~~~~~~~~v~~h~lgt~~~~d~lv~~e-~~~~~~~~~~~s~d~~~l~i~~~~~----~~~~~ 249 (686)
T PRK10115 175 PSFVWANDSWTFYYVRKHPVTLLPYQVWRHTIGTPASQDELVYEE-KDDTFYVSLHKTTSKHYVVIHLASA----TTSEV 249 (686)
T ss_pred eEEEEeeCCCEEEEEEecCCCCCCCEEEEEECCCChhHCeEEEee-CCCCEEEEEEEcCCCCEEEEEEECC----ccccE
Confidence 46999999987665432 2 2445666666 22222221 1233332222 33555555444332 45789
Q ss_pred EEEeCC--CCcEEEEEeeC-CceeEEEEeCCeEEEEEC---C--EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceE
Q 020784 159 MIWDDH--QSRCIGELSFR-SEVRSVKLRRDRIIVVLE---Q--KIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLV 230 (321)
Q Consensus 159 ~iWD~~--~~~~~~~~~~~-~~v~~v~~~~~~~~~~~~---~--~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~ 230 (321)
.+++.. .+.....+... ...+.+.-..+.+.+.++ . .|...++.+......+-.+.....+..+....+ .
T Consensus 250 ~l~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ly~~tn~~~~~~~l~~~~~~~~~~~~~l~~~~~~~~i~~~~~~~~--~ 327 (686)
T PRK10115 250 LLLDAELADAEPFVFLPRRKDHEYSLDHYQHRFYLRSNRHGKNFGLYRTRVRDEQQWEELIPPRENIMLEGFTLFTD--W 327 (686)
T ss_pred EEEECcCCCCCceEEEECCCCCEEEEEeCCCEEEEEEcCCCCCceEEEecCCCcccCeEEECCCCCCEEEEEEEECC--E
Confidence 999843 33322222222 222333323355666553 2 344444442222233333322223334444433 3
Q ss_pred EEeecCCCCcEEE--EeeCCcceEEee-ccccceeEEEEC--CC-CCEEEEEeC---CCcEEEEEEcCCCc
Q 020784 231 LVCPGLQKGQVRV--EHYASKRTKFIM-AHDSRIACFALT--QD-GQLLATSST---KGTLVRIFNTLDGT 292 (321)
Q Consensus 231 la~sGs~dg~V~i--~d~~~~~~~~l~-~H~~~V~~vafs--pd-g~~las~S~---Dgt~IrIWd~~tg~ 292 (321)
|+++...+|.-++ .+...+....+. .....+..+.++ ++ +.++++.+. -+. |..+|+.+++
T Consensus 328 l~~~~~~~g~~~l~~~~~~~~~~~~l~~~~~~~~~~~~~~~~~~~~~~~~~~ss~~~P~~-~y~~d~~~~~ 397 (686)
T PRK10115 328 LVVEERQRGLTSLRQINRKTREVIGIAFDDPAYVTWIAYNPEPETSRLRYGYSSMTTPDT-LFELDMDTGE 397 (686)
T ss_pred EEEEEEeCCEEEEEEEcCCCCceEEecCCCCceEeeecccCCCCCceEEEEEecCCCCCE-EEEEECCCCc
Confidence 3334677776666 444333444433 222334444455 33 345554433 445 7778888775
No 491
>PF01213 CAP_N: Adenylate cyclase associated (CAP) N terminal; InterPro: IPR013992 Cyclase-associated proteins (CAPs) are highly conserved actin-binding proteins present in a wide range of organisms including yeast, fly, plants, and mammals. CAPs are multifunctional proteins that contain several structural domains. CAP is involved in species-specific signalling pathways [, , , ]. In Drosophila, CAP functions in Hedgehog-mediated eye development and in establishing oocyte polarity. In Dictyostelium (slim mold), CAP is involved in microfilament reorganisation near the plasma membrane in a PIP2-regulated manner and is required to perpetuate the cAMP relay signal to organise fruitbody formation. In plants, CAP is involved in plant signalling pathways required for co-ordinated organ expansion. In yeast, CAP is involved in adenylate cyclase activation, as well as in vesicle trafficking and endocytosis. In both yeast and mammals, CAPs appear to be involved in recycling G-actin monomers from ADF/cofilins for subsequent rounds of filament assembly [, ]. In mammals, there are two different CAPs (CAP1 and CAP2) that share 64% amino acid identity. All CAPs appear to contain a C-terminal actin-binding domain that regulates actin remodelling in response to cellular signals and is required for normal cellular morphology, cell division, growth and locomotion in eukaryotes. CAP directly regulates actin filament dynamics and has been implicated in a number of complex developmental and morphological processes, including mRNA localisation and the establishment of cell polarity. Actin exists both as globular (G) (monomeric) actin subunits and assembled into filamentous (F) actin. In cells, actin cycles between these two forms. Proteins that bind F-actin often regulate F-actin assembly and its interaction with other proteins, while proteins that interact with G-actin often control the availability of unpolymerised actin. CAPs bind G-actin. In addition to actin-binding, CAPs can have additional roles, and may act as bifunctional proteins. In Saccharomyces cerevisiae (Baker's yeast), CAP is a component of the adenylyl cyclase complex (Cyr1p) that serves as an effector of Ras during normal cell signalling. S. cerevisiae CAP functions to expose adenylate cyclase binding sites to Ras, thereby enabling adenylate cyclase to be activated by Ras regulatory signals. In Schizosaccharomyces pombe (Fission yeast), CAP is also required for adenylate cyclase activity, but not through the Ras pathway. In both organisms, the N-terminal domain is responsible for adenylate cyclase activation, but the S cerevisiae and S. pombe N-termini cannot complement one another. Yeast CAPs are unique among the CAP family of proteins, because they are the only ones to directly interact with and activate adenylate cyclase []. S. cerevisiae CAP has four major domains. In addition to the N-terminal adenylate cyclase-interacting domain, and the C-terminal actin-binding domain, it possesses two other domains: a proline-rich domain that interacts with Src homology 3 (SH3) domains of specific proteins, and a domain that is responsible for CAP oligomerisation to form multimeric complexes (although oligomerisation appears to involve the N- and C-terminal domains as well). The proline-rich domain interacts with profilin, a protein that catalyses nucleotide exchange on G-actin monomers and promotes addition to barbed ends of filamentous F-actin []. Since CAP can bind profilin via a proline-rich domain, and G-actin via a C-terminal domain, it has been suggested that a ternary G-actin/CAP/profilin complex could be formed. This entry represents the N-terminal domain of CAP proteins. This domain has an all-alpha structure consisting of six helices in a bundle with a left-handed twist and an up-and-down topology [].; GO: 0003779 actin binding, 0007010 cytoskeleton organization; PDB: 1TJF_B 1S0P_A.
Probab=41.81 E-value=8.6 Score=34.85 Aligned_cols=12 Identities=58% Similarity=1.411 Sum_probs=0.0
Q ss_pred CCCCCCCCCCCCC
Q 020784 12 PEPTPDPNPNPNP 24 (321)
Q Consensus 12 ~~~~~~~~~~~~~ 24 (321)
|+||||||| |.|
T Consensus 234 pPPppPpPP-~~~ 245 (312)
T PF01213_consen 234 PPPPPPPPP-PAP 245 (312)
T ss_dssp -------------
T ss_pred CCCCCCCcc-ccc
Confidence 334444444 444
No 492
>PF07250 Glyoxal_oxid_N: Glyoxal oxidase N-terminus; InterPro: IPR009880 This entry represents the N terminus (approximately 300 residues) of a number of plant and fungal glyoxal oxidase enzymes. Glyoxal oxidase catalyses the oxidation of aldehydes to carboxylic acids, coupled with reduction of dioxygen to hydrogen peroxide. It is an essential component of the extracellular lignin degradation pathways of the wood-rot fungus Phanerochaete chrysosporium [].
Probab=41.23 E-value=1.9e+02 Score=25.20 Aligned_cols=115 Identities=17% Similarity=0.238 Sum_probs=54.1
Q ss_pred EEcCCCCEEEEEcC-C---cEEEEEecC--CceeEEe---eeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEe
Q 020784 92 SFNQDHGCFAAGTD-H---GFRIYNCDP--FREIFRR---DFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWD 162 (321)
Q Consensus 92 ~fs~dg~~lasg~~-~---gv~vw~~~~--~~~~~~~---~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD 162 (321)
+|-+||++|.+|++ + ++|+++-.. ....... .+.....-..+...++++.+++.+ .. .-+.-.|.
T Consensus 73 ~~L~dG~ll~tGG~~~G~~~ir~~~p~~~~~~~~w~e~~~~m~~~RWYpT~~~L~DG~vlIvGG-~~-----~~t~E~~P 146 (243)
T PF07250_consen 73 AFLPDGRLLQTGGDNDGNKAIRIFTPCTSDGTCDWTESPNDMQSGRWYPTATTLPDGRVLIVGG-SN-----NPTYEFWP 146 (243)
T ss_pred CCCCCCCEEEeCCCCccccceEEEecCCCCCCCCceECcccccCCCccccceECCCCCEEEEeC-cC-----CCcccccC
Confidence 36789999999987 3 377776433 1111110 011123344556667777555544 32 23344454
Q ss_pred CCC-CcEEEEEeeCC--------ce-eEEEEeCC-eEEEEECCEEEEEEcCCcEEEEEEec
Q 020784 163 DHQ-SRCIGELSFRS--------EV-RSVKLRRD-RIIVVLEQKIFVYNFADLKLLHQIET 212 (321)
Q Consensus 163 ~~~-~~~~~~~~~~~--------~v-~~v~~~~~-~~~~~~~~~I~iwd~~~~~~~~~l~~ 212 (321)
-+. ......+.+-. .- --+...++ .+++.....-.|||..+.+.++.+..
T Consensus 147 ~~~~~~~~~~~~~l~~~~~~~~~nlYP~~~llPdG~lFi~an~~s~i~d~~~n~v~~~lP~ 207 (243)
T PF07250_consen 147 PKGPGPGPVTLPFLSQTSDTLPNNLYPFVHLLPDGNLFIFANRGSIIYDYKTNTVVRTLPD 207 (243)
T ss_pred CccCCCCceeeecchhhhccCccccCceEEEcCCCCEEEEEcCCcEEEeCCCCeEEeeCCC
Confidence 321 11111111100 00 01222333 34444445666778877776666643
No 493
>TIGR03118 PEPCTERM_chp_1 conserved hypothetical protein TIGR03118. This model describes and uncharacterized conserved hypothetical protein. Members are found with the C-terminal putative exosortase interaction domain, PEP-CTERM, in Nitrosospira multiformis, Rhodoferax ferrireducens, Solibacter usitatus Ellin6076, and Acidobacteria bacterium Ellin345. It is found without the PEP-CTERM domain in several other species, including Burkholderia ambifaria, Gloeobacter violaceus PCC 7421, and three copies in the Acanthamoeba polyphaga mimivirus.
Probab=39.89 E-value=2.9e+02 Score=25.12 Aligned_cols=68 Identities=19% Similarity=0.215 Sum_probs=48.6
Q ss_pred cCCCCcEEEEeeCCcceEEe--eccccceeEEEECC------CCCEEEEEeCCCcEEEEEEcCCCcEEEEEeCCCcc
Q 020784 235 GLQKGQVRVEHYASKRTKFI--MAHDSRIACFALTQ------DGQLLATSSTKGTLVRIFNTLDGTLLQEECCPSIS 303 (321)
Q Consensus 235 Gs~dg~V~i~d~~~~~~~~l--~~H~~~V~~vafsp------dg~~las~S~Dgt~IrIWd~~tg~~i~~~~~g~~~ 303 (321)
|-.-|.|.++|....-+..+ .+.-+..+.|+.-| .|.+|+-==-||+ |.+||..+|+.+..+......
T Consensus 218 G~G~G~VdvFd~~G~l~~r~as~g~LNaPWG~a~APa~FG~~sg~lLVGNFGDG~-InaFD~~sG~~~g~L~~~~G~ 293 (336)
T TIGR03118 218 GAGLGYVNVFTLNGQLLRRVASSGRLNAPWGLAIAPESFGSLSGALLVGNFGDGT-INAYDPQSGAQLGQLLDPDNH 293 (336)
T ss_pred CCCcceEEEEcCCCcEEEEeccCCcccCCceeeeChhhhCCCCCCeEEeecCCce-eEEecCCCCceeeeecCCCCC
Confidence 56678899988866555444 34455677788755 4677775444999 999999999999888765443
No 494
>KOG1896 consensus mRNA cleavage and polyadenylation factor II complex, subunit CFT1 (CPSF subunit) [RNA processing and modification]
Probab=39.77 E-value=5.3e+02 Score=28.10 Aligned_cols=36 Identities=11% Similarity=0.261 Sum_probs=23.0
Q ss_pred CCCCcEEE--EeeCCcceEEeecc-------------ccceeEEEECCCCC
Q 020784 236 LQKGQVRV--EHYASKRTKFIMAH-------------DSRIACFALTQDGQ 271 (321)
Q Consensus 236 s~dg~V~i--~d~~~~~~~~l~~H-------------~~~V~~vafspdg~ 271 (321)
..|-+|-+ ||..+..+.++.-| ...+..|...||++
T Consensus 98 f~~AKiSvlefD~~t~sl~TlSLHyfE~~~~~~~~~~~~~~p~vrvDPdsr 148 (1366)
T KOG1896|consen 98 FKDAKISVLEFDPQTNSLRTLSLHYFEGPEFRKGLVGRAKIPTVRVDPDSR 148 (1366)
T ss_pred eccceEEEEEecCCccceeeeeeEEeccccccccccccccCceEEECCCCC
Confidence 45566776 88776666554433 11366788899987
No 495
>PRK12633 flgD flagellar basal body rod modification protein; Provisional
Probab=39.25 E-value=1.9e+02 Score=24.95 Aligned_cols=87 Identities=14% Similarity=0.143 Sum_probs=40.7
Q ss_pred EEEEEEcCCcEEEEEEeccCCCCceEEEeeCCC---ceEEEeecCCCCcEEEE--eeCCcceEEeeccccceeEEEECCC
Q 020784 195 KIFVYNFADLKLLHQIETIANPKGLCAVSQGVG---SLVLVCPGLQKGQVRVE--HYASKRTKFIMAHDSRIACFALTQD 269 (321)
Q Consensus 195 ~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d---~~~la~sGs~dg~V~i~--d~~~~~~~~l~~H~~~V~~vafspd 269 (321)
+|.|+|- .++.++++.......+...|.+++. +..+. .|.+ ++.+- +...+.+..-..-.+.|..|.|..+
T Consensus 132 ~v~I~D~-~G~vV~t~~lg~~~aG~~~f~WDG~d~~G~~~~-~G~Y--~~~V~a~~~~G~~~~~~~~~~~~V~~V~~~~~ 207 (230)
T PRK12633 132 TVKVLDP-SGAVVRTMELGDLKTGVHTLQWDGNNDGGQPLA-DGKY--SITVSASDADAKPVKAEALTYGQVKSVAYSTN 207 (230)
T ss_pred EEEEEeC-CCCEEEEEecCCCCCCceeEEECCCCCCCCcCC-Ccce--EEEEEEEeCCCcEEeeeeeEEEEEEEEEecCC
Confidence 3555553 4556666554333344455555542 12221 1221 33331 2222222211112457999999887
Q ss_pred CCEEEEEeCCCcEEEEEE
Q 020784 270 GQLLATSSTKGTLVRIFN 287 (321)
Q Consensus 270 g~~las~S~Dgt~IrIWd 287 (321)
+.+|..++ .+. |.+=|
T Consensus 208 ~~~l~l~~-~~~-v~l~~ 223 (230)
T PRK12633 208 GLRLDLGL-AGQ-ISMLD 223 (230)
T ss_pred ceEEEEcC-CcE-EeHHH
Confidence 77766553 344 65433
No 496
>PF08954 DUF1900: Domain of unknown function (DUF1900); InterPro: IPR015049 This domain is predominantly found in the structural protein coronin, and is duplicated in some sequences. It has no known function []. ; PDB: 2B4E_A 2AQ5_A.
Probab=39.09 E-value=1.3e+02 Score=23.68 Aligned_cols=71 Identities=11% Similarity=0.130 Sum_probs=36.2
Q ss_pred eEEEeeCCCceEEEeecCCCCcEEEEeeCCc--ceEEeec--cccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCc
Q 020784 219 LCAVSQGVGSLVLVCPGLQKGQVRVEHYASK--RTKFIMA--HDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGT 292 (321)
Q Consensus 219 ~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~--~~~~l~~--H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~ 292 (321)
++.-..+.|..+|...|-.|+.|+++.+... .+..+.. +......++|-|... +- =....+.|++.+.+.+
T Consensus 13 ~L~P~yD~dt~llyl~gKGD~~ir~yEv~~~~p~l~~l~~~~s~~~~~G~~~lPK~~-~d--v~~~Ei~R~lkl~~~~ 87 (136)
T PF08954_consen 13 VLMPFYDEDTNLLYLAGKGDGNIRYYEVSDESPYLHYLSEYRSPEPQKGFAFLPKRA-CD--VMKCEIARFLKLTNDK 87 (136)
T ss_dssp -EEEEE-TTT-EEEEEETT-S-EEEEEE-SSTTSEEEEEEE--SS--SEEEE--GGG-S---GGGTEEEEEEEEETTE
T ss_pred eeEeeEcCCCCEEEEEeccCcEEEEEEEcCCCCceEEccccccCCCeEeeEecCccc-CC--chheeeeeeeeecCCc
Confidence 3334456666666667999999999988766 3554444 345678888888532 11 1123346666666555
No 497
>PF07250 Glyoxal_oxid_N: Glyoxal oxidase N-terminus; InterPro: IPR009880 This entry represents the N terminus (approximately 300 residues) of a number of plant and fungal glyoxal oxidase enzymes. Glyoxal oxidase catalyses the oxidation of aldehydes to carboxylic acids, coupled with reduction of dioxygen to hydrogen peroxide. It is an essential component of the extracellular lignin degradation pathways of the wood-rot fungus Phanerochaete chrysosporium [].
Probab=38.71 E-value=1.2e+02 Score=26.40 Aligned_cols=69 Identities=13% Similarity=0.164 Sum_probs=41.2
Q ss_pred CceEEEeecCCCCcEEEEeeCC---cceE-Eeecc-----ccc-eeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEEEE
Q 020784 227 GSLVLVCPGLQKGQVRVEHYAS---KRTK-FIMAH-----DSR-IACFALTQDGQLLATSSTKGTLVRIFNTLDGTLLQE 296 (321)
Q Consensus 227 d~~~la~sGs~dg~V~i~d~~~---~~~~-~l~~H-----~~~-V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i~~ 296 (321)
||.++++.|...-+..+|.-.. .... .+... ... =--+-..|||++|+-+..+ . + |||..+.+.+++
T Consensus 128 DG~vlIvGG~~~~t~E~~P~~~~~~~~~~~~~l~~~~~~~~~nlYP~~~llPdG~lFi~an~~-s-~-i~d~~~n~v~~~ 204 (243)
T PF07250_consen 128 DGRVLIVGGSNNPTYEFWPPKGPGPGPVTLPFLSQTSDTLPNNLYPFVHLLPDGNLFIFANRG-S-I-IYDYKTNTVVRT 204 (243)
T ss_pred CCCEEEEeCcCCCcccccCCccCCCCceeeecchhhhccCccccCceEEEcCCCCEEEEEcCC-c-E-EEeCCCCeEEee
Confidence 5577777677665667665421 1111 11111 011 1235567999999988754 4 3 899999988777
Q ss_pred Ee
Q 020784 297 EC 298 (321)
Q Consensus 297 ~~ 298 (321)
+.
T Consensus 205 lP 206 (243)
T PF07250_consen 205 LP 206 (243)
T ss_pred CC
Confidence 64
No 498
>KOG2675 consensus Adenylate cyclase-associated protein (CAP/Srv2p) [Cytoskeleton; Signal transduction mechanisms]
Probab=37.83 E-value=28 Score=32.73 Aligned_cols=34 Identities=29% Similarity=0.372 Sum_probs=0.0
Q ss_pred CcccccccCCCCCCCCCCCCC-----CCCCCCCccCCCC
Q 020784 1 MAALSAYSSPWPEPTPDPNPN-----PNPNSNTSCGVSS 34 (321)
Q Consensus 1 ~~~~~~~~~~~~~~~~~~~~~-----~~~~~~~~~~~~~ 34 (321)
|..-+|=.-|=|+||||||.. +++.++...+-++
T Consensus 227 ~~~~s~~g~PPPPPP~PPp~~~~~~~~~~~~~~~k~~~~ 265 (480)
T KOG2675|consen 227 PKAASAPGAPPPPPPAPPPAPFFADSNPPSSDANKGGRG 265 (480)
T ss_pred cCcccCCCCCCCCCCCCCCcccccccCCCCcccccccHH
No 499
>COG5290 IkappaB kinase complex, IKAP component [Transcription]
Probab=37.77 E-value=2.3e+02 Score=29.32 Aligned_cols=157 Identities=10% Similarity=0.068 Sum_probs=0.0
Q ss_pred EEEEEcCCCCEEEEEc-----CCcEEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEe-
Q 020784 89 LHISFNQDHGCFAAGT-----DHGFRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWD- 162 (321)
Q Consensus 89 ~~v~fs~dg~~lasg~-----~~gv~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD- 162 (321)
..+.|--|.++++.|. .+.+|||.-+-.---..-.. .|--..+.|-|.+..+++.+ .+...+.-.|+.+.
T Consensus 205 ~~i~wrgD~~y~~v~r~Ee~prra~rvysreg~lds~sep~--~g~e~~LSWkpqgS~~ati~--td~~~~S~~ViFfEr 280 (1243)
T COG5290 205 KIIFWRGDTEYNLVGRSEERPRRAFRVYSREGQLDSASEPV--TGMEHQLSWKPQGSKYATIG--TDGCSTSESVIFFER 280 (1243)
T ss_pred eEEEEccCcceeeecchhcccccceeeeccccccccccCCc--ccchhccccccCCceeeeec--cCCCCCcceEEEEcc
Q ss_pred --CCCCcEEEEEeeCCceeEEEEe--CCeEEEEECCEEEEEEcCCcEEEEEEeccCCCCceEEEeeCCCceEEEeecCCC
Q 020784 163 --DHQSRCIGELSFRSEVRSVKLR--RDRIIVVLEQKIFVYNFADLKLLHQIETIANPKGLCAVSQGVGSLVLVCPGLQK 238 (321)
Q Consensus 163 --~~~~~~~~~~~~~~~v~~v~~~--~~~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~~~~~s~~~d~~~la~sGs~d 238 (321)
++-|+.-.....+..+..++|+ ...++++.++.|++|-..+..=--+.......+..+.+++..++.++. +..
T Consensus 281 NGLrHGef~lr~~~dEk~~~~~wn~~s~vlav~~~n~~~lwttkNyhWYLK~e~~ip~~s~vkwhpe~~nTl~f---~d~ 357 (1243)
T COG5290 281 NGLRHGEFDLRVGCDEKAFLENWNLLSTVLAVAEGNLLKLWTTKNYHWYLKVERQIPGISYVKWHPEEKNTLLF---RDG 357 (1243)
T ss_pred CCcccCCccccCCchhhhhhhhhhHHHHHHHHhhcceEEEEEccceEEEEEEeecCCCcceeeeccccCcEEEE---ecC
Q ss_pred CcEEEEeeCCcceE
Q 020784 239 GQVRVEHYASKRTK 252 (321)
Q Consensus 239 g~V~i~d~~~~~~~ 252 (321)
+.|..-++..+..+
T Consensus 358 ~~I~~V~f~~k~~~ 371 (1243)
T COG5290 358 ERILRVFFSEKKTH 371 (1243)
T ss_pred CeEEEEEeehhhhc
No 500
>KOG1983 consensus Tomosyn and related SNARE-interacting proteins [Intracellular trafficking, secretion, and vesicular transport]
Probab=37.56 E-value=5.5e+02 Score=27.59 Aligned_cols=194 Identities=11% Similarity=0.005 Sum_probs=0.0
Q ss_pred EEEcCCCCEEEEEcCCc-EEEEEecCCceeEEeeeecCCceEEEEEecCCCeEEEEeCCCCCCCCCCcEEEEeCCCCcEE
Q 020784 91 ISFNQDHGCFAAGTDHG-FRIYNCDPFREIFRRDFERGGGIGVVEMLFRCNILALVGGGPDPQYPLNKVMIWDDHQSRCI 169 (321)
Q Consensus 91 v~fs~dg~~lasg~~~g-v~vw~~~~~~~~~~~~~~~~~~v~~v~~~~~~~~~~~~sg~~~~~~~d~~v~iWD~~~~~~~ 169 (321)
++|++.-.++|.|...| +.+|-..-.+.......+....+..+.+........... .+..+.+|-......+
T Consensus 41 ~afD~~q~llai~t~tg~i~~yg~~~ve~~~~~~~~~~~~~~~~~~~~~~s~~~~l~-------~~~~~~~~~~~~~~~~ 113 (993)
T KOG1983|consen 41 LAFDPTQGLLAIGTRTGAIKIYGQPGVEFVGLHPKQNQINVTRIELLVGISRNLVLS-------DDDSLHLWSIKIKTGV 113 (993)
T ss_pred eeeccccceEEEEEecccEEEecccceEEEeccccccchhhhheeeeecccccceee-------cccceeeeccccccee
Q ss_pred EEEee-------------------------------CCceeEEEEeCCeEEEEECCEEEEEEcCCcEEEEEEeccCCCCc
Q 020784 170 GELSF-------------------------------RSEVRSVKLRRDRIIVVLEQKIFVYNFADLKLLHQIETIANPKG 218 (321)
Q Consensus 170 ~~~~~-------------------------------~~~v~~v~~~~~~~~~~~~~~I~iwd~~~~~~~~~l~~~~~~~~ 218 (321)
..... .-.+.....+...........+.+=.+-.............+ .
T Consensus 114 ~~~~~~~~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~s~~~~~~~~~~~~~~~~~~~~~~~-~ 192 (993)
T KOG1983|consen 114 FLKQEITSFVTDPPPDWLIGENGLVKVSDVLRHQLSDLKYAGTESSNFVPYESLSPTLSIEGLVIDLDTVLISLPDAY-L 192 (993)
T ss_pred ecCCcceeccCCCCcchhcccCceeeEeeechhhhccceeccccccccceeeeeccceeeeccccccccceeeccccc-c
Q ss_pred eEEEeeCCCceEEEeecCCCCcEEEEeeCCcceE----EeeccccceeEEEECCCCCEEEEEeCCCcEEEEEEcCCCcEE
Q 020784 219 LCAVSQGVGSLVLVCPGLQKGQVRVEHYASKRTK----FIMAHDSRIACFALTQDGQLLATSSTKGTLVRIFNTLDGTLL 294 (321)
Q Consensus 219 ~~~~s~~~d~~~la~sGs~dg~V~i~d~~~~~~~----~l~~H~~~V~~vafspdg~~las~S~Dgt~IrIWd~~tg~~i 294 (321)
.+.+......+.+.+ ..++.....+...--.. .+..|.-.+.....++++..++++..||+ +..||+..|+.+
T Consensus 193 ~~~~~~~~~~~~~~~--~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~h~Dgs-~~fWd~s~g~~~ 269 (993)
T KOG1983|consen 193 GLSLIEYESLQVLYY--SPTKILIGFNRGLVVIKDRASKYVQSAYLPNGQLESRDGSHFVSYHTDGS-YAFWDVSSGKLQ 269 (993)
T ss_pred cccccccccceeeee--cCCCcceeeeeeeeeehhcccccchhhcccccccCccCCceEEEEEecCC-EEeeecCCCcee
Q ss_pred E
Q 020784 295 Q 295 (321)
Q Consensus 295 ~ 295 (321)
.
T Consensus 270 ~ 270 (993)
T KOG1983|consen 270 I 270 (993)
T ss_pred e
Done!