Query 000080
Match_columns 2389
No_of_seqs 459 out of 1132
Neff 4.1
Searched_HMMs 46136
Date Thu Mar 28 17:06:52 2013
Command hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/000080.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/000080hhsearch_cdd -cpu 12 -v 0
No Hit Prob E-value P-value Score SS Cols Query HMM Template HMM
1 KOG1064 RAVE (regulator of V-A 100.0 0E+00 0E+00 3012.8 89.5 2154 31-2386 5-2356(2439)
2 PF12234 Rav1p_C: RAVE protein 100.0 1E-141 3E-146 1321.0 57.8 618 747-1483 1-631 (631)
3 KOG0645 WD40 repeat protein [G 100.0 2.3E-29 5E-34 285.0 20.4 165 85-286 7-181 (312)
4 KOG0645 WD40 repeat protein [G 99.9 3.2E-27 7E-32 267.7 17.4 201 36-285 103-311 (312)
5 KOG0276 Vesicle coat complex C 99.9 4E-26 8.7E-31 276.7 13.4 175 2185-2384 68-245 (794)
6 KOG0318 WD40 repeat stress pro 99.9 2.3E-22 5E-27 241.9 27.3 288 27-370 4-353 (603)
7 KOG0272 U4/U6 small nuclear ri 99.9 7.4E-23 1.6E-27 242.1 12.1 173 2191-2384 272-448 (459)
8 KOG0272 U4/U6 small nuclear ri 99.9 1.1E-22 2.4E-27 240.6 9.4 173 2189-2383 227-405 (459)
9 KOG0271 Notchless-like WD40 re 99.8 1.7E-20 3.6E-25 219.9 13.3 135 2221-2374 117-255 (480)
10 KOG0266 WD40 repeat-containing 99.8 8.1E-20 1.8E-24 227.0 18.9 145 2220-2385 204-353 (456)
11 KOG0263 Transcription initiati 99.8 3.7E-20 8.1E-25 231.6 13.5 144 2220-2384 452-595 (707)
12 KOG0279 G protein beta subunit 99.8 4E-19 8.6E-24 203.3 19.4 225 2082-2380 16-247 (315)
13 KOG0263 Transcription initiati 99.8 1.2E-19 2.7E-24 227.0 16.2 139 2196-2354 509-651 (707)
14 KOG0319 WD40-repeat-containing 99.8 2.2E-19 4.7E-24 222.8 15.0 174 2188-2383 420-606 (775)
15 KOG0286 G-protein beta subunit 99.8 1.5E-18 3.4E-23 199.2 16.2 167 2189-2379 161-328 (343)
16 KOG0271 Notchless-like WD40 re 99.8 1.8E-18 3.9E-23 203.0 13.5 163 2193-2377 128-299 (480)
17 KOG0295 WD40 repeat-containing 99.8 3E-18 6.6E-23 200.9 15.0 173 2189-2384 159-352 (406)
18 KOG0266 WD40 repeat-containing 99.8 4.3E-18 9.3E-23 211.7 16.5 145 2221-2385 161-307 (456)
19 KOG0292 Vesicle coat complex C 99.8 5E-18 1.1E-22 212.2 14.5 176 2192-2384 63-268 (1202)
20 KOG0279 G protein beta subunit 99.7 1E-17 2.2E-22 191.9 15.5 162 2198-2380 40-206 (315)
21 KOG0291 WD40-repeat-containing 99.7 1.5E-17 3.3E-22 206.4 17.2 146 2220-2381 351-535 (893)
22 PTZ00421 coronin; Provisional 99.7 9.7E-17 2.1E-21 201.6 19.1 142 2221-2383 77-228 (493)
23 KOG0273 Beta-transducin family 99.7 1.1E-16 2.3E-21 192.2 17.4 195 2175-2383 233-469 (524)
24 KOG0292 Vesicle coat complex C 99.7 5.5E-17 1.2E-21 203.1 13.2 162 2203-2384 31-224 (1202)
25 KOG0295 WD40 repeat-containing 99.7 2.3E-16 5E-21 185.3 14.1 167 2193-2383 206-393 (406)
26 KOG0315 G-protein beta subunit 99.7 5.1E-16 1.1E-20 175.9 14.8 180 2185-2383 45-275 (311)
27 KOG0285 Pleiotropic regulator 99.7 3.8E-16 8.2E-21 182.7 13.2 136 2220-2376 152-287 (460)
28 PTZ00421 coronin; Provisional 99.7 2.3E-15 4.9E-20 189.4 20.1 173 2192-2382 88-275 (493)
29 PTZ00420 coronin; Provisional 99.7 1.7E-15 3.8E-20 192.5 19.2 149 2221-2384 76-232 (568)
30 KOG0286 G-protein beta subunit 99.7 8E-16 1.7E-20 177.2 14.6 142 2220-2383 146-290 (343)
31 KOG0319 WD40-repeat-containing 99.7 4.4E-16 9.5E-21 193.9 13.3 180 2193-2385 378-566 (775)
32 KOG0284 Polyadenylation factor 99.7 1.5E-16 3.2E-21 188.7 8.7 143 2221-2384 140-282 (464)
33 KOG0315 G-protein beta subunit 99.6 1.7E-15 3.8E-20 171.6 15.6 171 2193-2374 96-308 (311)
34 KOG0285 Pleiotropic regulator 99.6 1.2E-15 2.7E-20 178.6 13.8 172 2192-2385 163-338 (460)
35 KOG0276 Vesicle coat complex C 99.6 1.2E-15 2.6E-20 186.9 14.1 144 2217-2379 53-196 (794)
36 KOG0284 Polyadenylation factor 99.6 3.9E-16 8.5E-21 185.1 9.7 178 2179-2379 181-363 (464)
37 KOG0293 WD40 repeat-containing 99.6 4.2E-15 9.1E-20 176.4 16.4 212 35-287 221-515 (519)
38 PLN00181 protein SPA1-RELATED; 99.6 6.4E-15 1.4E-19 194.2 20.0 172 2193-2385 546-727 (793)
39 KOG0273 Beta-transducin family 99.6 6.3E-15 1.4E-19 177.3 15.0 140 2220-2381 360-508 (524)
40 PLN00181 protein SPA1-RELATED; 99.6 1.7E-14 3.6E-19 190.3 19.9 171 2191-2384 494-678 (793)
41 cd00200 WD40 WD40 domain, foun 99.6 3.2E-14 6.9E-19 153.9 18.4 144 2221-2385 11-154 (289)
42 KOG0316 Conserved WD40 repeat- 99.6 6.3E-15 1.4E-19 166.1 13.0 113 2221-2352 19-131 (307)
43 KOG0275 Conserved WD40 repeat- 99.6 1.2E-15 2.7E-20 176.0 6.6 164 2194-2378 227-404 (508)
44 KOG0265 U5 snRNP-specific prot 99.6 1.2E-14 2.7E-19 168.1 14.7 171 2191-2384 58-234 (338)
45 cd00200 WD40 WD40 domain, foun 99.6 7.3E-14 1.6E-18 151.1 18.6 168 2194-2383 23-194 (289)
46 PTZ00420 coronin; Provisional 99.6 7.2E-14 1.6E-18 177.9 21.3 153 2191-2362 86-257 (568)
47 KOG0267 Microtubule severing p 99.6 2.6E-15 5.6E-20 186.6 7.1 166 2195-2383 43-212 (825)
48 KOG0269 WD40 repeat-containing 99.6 1.6E-14 3.4E-19 180.9 12.9 144 2223-2385 137-282 (839)
49 KOG0301 Phospholipase A2-activ 99.5 2.6E-14 5.6E-19 177.5 14.0 164 2190-2382 110-275 (745)
50 KOG0281 Beta-TrCP (transducin 99.5 4.9E-15 1.1E-19 172.7 6.5 166 2191-2377 206-411 (499)
51 KOG0310 Conserved WD40 repeat- 99.5 4.4E-14 9.6E-19 171.0 14.4 143 2221-2384 112-256 (487)
52 KOG0275 Conserved WD40 repeat- 99.5 3.5E-15 7.7E-20 172.3 4.7 151 2221-2384 215-366 (508)
53 KOG0318 WD40 repeat stress pro 99.5 7.6E-14 1.7E-18 169.6 15.7 166 2198-2384 131-338 (603)
54 KOG0291 WD40-repeat-containing 99.5 6.3E-14 1.4E-18 174.9 14.6 144 2221-2383 309-495 (893)
55 KOG0277 Peroxisomal targeting 99.5 1E-13 2.3E-18 157.9 14.5 146 2221-2385 106-253 (311)
56 KOG1332 Vesicle coat complex C 99.5 1.4E-13 3.1E-18 156.2 14.8 212 36-292 54-293 (299)
57 KOG0308 Conserved WD40 repeat- 99.5 1.7E-13 3.8E-18 169.4 16.5 177 2194-2383 87-272 (735)
58 KOG0283 WD40 repeat-containing 99.5 5.2E-14 1.1E-18 178.4 12.2 153 2218-2383 266-468 (712)
59 KOG0267 Microtubule severing p 99.5 1.5E-14 3.3E-19 179.8 7.3 162 2202-2386 91-258 (825)
60 KOG0305 Anaphase promoting com 99.5 1.7E-13 3.7E-18 170.2 14.6 155 2221-2383 219-448 (484)
61 KOG0265 U5 snRNP-specific prot 99.5 2E-13 4.3E-18 158.3 13.5 172 2194-2383 147-325 (338)
62 KOG0306 WD40-repeat-containing 99.5 4.9E-13 1.1E-17 167.1 17.6 165 2200-2385 473-653 (888)
63 KOG0274 Cdc4 and related F-box 99.5 3.1E-13 6.8E-18 171.5 16.3 132 2220-2376 250-381 (537)
64 KOG0973 Histone transcription 99.5 1.1E-12 2.4E-17 169.8 19.8 214 36-283 67-310 (942)
65 KOG0647 mRNA export protein (c 99.5 7.1E-13 1.5E-17 153.9 15.3 123 2221-2363 29-154 (347)
66 KOG0313 Microtubule binding pr 99.5 5.3E-13 1.1E-17 158.2 14.3 169 2190-2377 203-400 (423)
67 KOG0282 mRNA splicing factor [ 99.5 1.3E-13 2.9E-18 166.7 9.6 173 2189-2383 224-402 (503)
68 KOG0302 Ribosome Assembly prot 99.4 7.7E-13 1.7E-17 156.6 15.4 158 2172-2352 220-378 (440)
69 KOG0310 Conserved WD40 repeat- 99.4 3.6E-13 7.8E-18 163.3 11.7 142 2222-2383 71-213 (487)
70 KOG0772 Uncharacterized conser 99.4 8.3E-13 1.8E-17 160.2 14.3 182 2194-2384 181-382 (641)
71 KOG0277 Peroxisomal targeting 99.4 1.3E-12 2.8E-17 149.1 14.8 141 2222-2382 63-206 (311)
72 KOG0973 Histone transcription 99.4 8.5E-13 1.9E-17 170.8 14.9 143 2220-2383 70-236 (942)
73 KOG0282 mRNA splicing factor [ 99.4 7.8E-14 1.7E-18 168.7 5.1 141 2221-2384 216-360 (503)
74 KOG0647 mRNA export protein (c 99.4 1.5E-12 3.3E-17 151.2 15.1 186 2176-2380 25-307 (347)
75 KOG0274 Cdc4 and related F-box 99.4 6.2E-13 1.3E-17 168.8 13.0 156 2192-2374 261-421 (537)
76 KOG0308 Conserved WD40 repeat- 99.4 3.4E-13 7.3E-18 166.9 10.1 169 2200-2384 51-231 (735)
77 KOG0640 mRNA cleavage stimulat 99.4 2.8E-13 6.1E-18 156.9 8.0 148 2221-2384 174-323 (430)
78 KOG0313 Microtubule binding pr 99.4 1.5E-12 3.2E-17 154.5 13.6 176 2194-2382 161-361 (423)
79 KOG0264 Nucleosome remodeling 99.4 1.4E-12 3E-17 157.5 13.4 145 2221-2382 229-389 (422)
80 KOG0281 Beta-TrCP (transducin 99.4 3.3E-13 7.1E-18 157.8 6.9 131 2221-2376 322-459 (499)
81 KOG1407 WD40 repeat protein [F 99.4 1.3E-12 2.7E-17 149.7 11.4 150 2221-2384 22-249 (313)
82 KOG0303 Actin-binding protein 99.4 8.6E-13 1.9E-17 156.8 10.4 134 2221-2369 83-218 (472)
83 KOG1332 Vesicle coat complex C 99.4 1.7E-12 3.6E-17 147.7 10.9 178 86-286 4-194 (299)
84 KOG0640 mRNA cleavage stimulat 99.4 2.8E-12 6.1E-17 148.8 12.6 154 2192-2364 184-345 (430)
85 KOG0316 Conserved WD40 repeat- 99.4 2.5E-12 5.4E-17 145.6 11.8 163 2200-2385 36-202 (307)
86 KOG0289 mRNA splicing factor [ 99.4 7.4E-12 1.6E-16 150.2 16.1 163 2200-2381 280-447 (506)
87 KOG0264 Nucleosome remodeling 99.4 2.9E-12 6.3E-17 154.7 12.6 148 2224-2382 182-332 (422)
88 KOG0278 Serine/threonine kinas 99.4 1.6E-12 3.4E-17 147.9 9.3 164 2194-2379 73-280 (334)
89 KOG0289 mRNA splicing factor [ 99.3 4.8E-12 1E-16 151.8 13.6 142 2220-2380 348-490 (506)
90 KOG2445 Nuclear pore complex c 99.3 9.6E-11 2.1E-15 136.8 23.6 248 49-323 22-312 (361)
91 KOG0293 WD40 repeat-containing 99.3 7.3E-12 1.6E-16 149.4 12.7 144 2221-2385 226-373 (519)
92 KOG1063 RNA polymerase II elon 99.3 2E-09 4.3E-14 135.1 33.8 603 31-909 7-640 (764)
93 KOG0296 Angio-associated migra 99.3 1.9E-11 4.1E-16 144.8 15.3 143 2220-2383 65-207 (399)
94 KOG0306 WD40-repeat-containing 99.3 1.2E-11 2.5E-16 155.1 13.5 137 2220-2378 455-604 (888)
95 KOG1009 Chromatin assembly com 99.3 1.5E-11 3.2E-16 147.2 10.9 153 2220-2384 14-183 (434)
96 KOG0772 Uncharacterized conser 99.3 5.4E-11 1.2E-15 144.9 15.4 298 16-365 148-466 (641)
97 KOG1407 WD40 repeat protein [F 99.2 7.1E-11 1.5E-15 135.7 14.9 177 2189-2378 74-284 (313)
98 KOG2445 Nuclear pore complex c 99.2 6E-10 1.3E-14 130.3 21.9 264 89-384 10-322 (361)
99 KOG0302 Ribosome Assembly prot 99.2 4.3E-11 9.4E-16 142.1 12.8 147 2223-2383 215-366 (440)
100 KOG1064 RAVE (regulator of V-A 99.2 1.4E-08 3E-13 136.0 36.6 193 15-214 18-255 (2439)
101 KOG0646 WD40 repeat protein [G 99.2 5.7E-11 1.2E-15 144.0 13.7 152 2220-2384 82-295 (476)
102 KOG0301 Phospholipase A2-activ 99.2 4.1E-11 8.9E-16 149.8 12.4 132 2223-2383 105-236 (745)
103 KOG0296 Angio-associated migra 99.2 1.1E-10 2.4E-15 138.5 15.4 145 2223-2384 152-386 (399)
104 KOG0294 WD40 repeat-containing 99.2 9.2E-11 2E-15 137.3 13.1 137 2222-2384 46-187 (362)
105 KOG0299 U3 snoRNP-associated p 99.2 4.5E-11 9.7E-16 144.7 10.7 144 2220-2374 143-294 (479)
106 KOG1446 Histone H3 (Lys4) meth 99.2 2.9E-10 6.3E-15 133.5 16.8 151 2220-2382 15-203 (311)
107 KOG0300 WD40 repeat-containing 99.2 4.4E-11 9.6E-16 139.0 9.2 175 2190-2383 122-331 (481)
108 KOG0288 WD40 repeat protein Ti 99.2 2.8E-11 6E-16 144.9 7.4 171 2190-2386 184-361 (459)
109 KOG0643 Translation initiation 99.2 1.8E-10 3.9E-15 132.7 13.4 152 2220-2382 53-247 (327)
110 KOG0299 U3 snoRNP-associated p 99.2 9.3E-11 2E-15 142.0 11.6 136 2220-2377 203-338 (479)
111 KOG1034 Transcriptional repres 99.2 4.9E-11 1.1E-15 140.0 8.8 144 2223-2384 93-267 (385)
112 KOG0283 WD40 repeat-containing 99.2 1.7E-10 3.8E-15 147.2 13.8 108 2222-2351 372-480 (712)
113 KOG1539 WD repeat protein [Gen 99.1 1.7E-10 3.6E-15 146.5 12.9 176 2183-2383 459-634 (910)
114 KOG0300 WD40 repeat-containing 99.1 2.9E-10 6.3E-15 132.4 13.3 156 2200-2377 291-455 (481)
115 KOG0639 Transducin-like enhanc 99.1 7E-11 1.5E-15 143.1 7.7 143 2220-2382 466-608 (705)
116 PF08662 eIF2A: Eukaryotic tra 99.1 7.6E-10 1.6E-14 124.7 15.3 116 2221-2361 61-185 (194)
117 TIGR03866 PQQ_ABC_repeats PQQ- 99.1 1.3E-09 2.8E-14 123.6 17.2 139 2223-2376 160-300 (300)
118 KOG0269 WD40 repeat-containing 99.1 8.2E-11 1.8E-15 148.4 7.9 144 2222-2384 90-238 (839)
119 KOG0643 Translation initiation 99.1 5.5E-10 1.2E-14 128.8 13.9 148 2223-2386 14-210 (327)
120 KOG0641 WD40 repeat protein [G 99.1 9.7E-10 2.1E-14 123.9 15.5 144 2220-2372 33-189 (350)
121 COG2319 FOG: WD40 repeat [Gene 99.1 1.8E-09 4E-14 121.1 17.6 142 2221-2383 157-301 (466)
122 KOG1034 Transcriptional repres 99.1 4.6E-10 1E-14 132.0 12.0 158 2221-2389 137-376 (385)
123 KOG0288 WD40 repeat protein Ti 99.1 9.6E-10 2.1E-14 132.1 14.7 166 2197-2385 278-450 (459)
124 TIGR03866 PQQ_ABC_repeats PQQ- 99.1 1.3E-09 2.9E-14 123.5 15.1 130 2231-2383 1-131 (300)
125 KOG1274 WD40 repeat protein [G 99.1 1.1E-09 2.3E-14 140.6 15.6 171 2190-2380 106-284 (933)
126 KOG0278 Serine/threonine kinas 99.1 5.9E-11 1.3E-15 135.4 3.8 139 2221-2381 61-199 (334)
127 KOG4283 Transcription-coupled 99.0 2.2E-09 4.8E-14 124.8 15.1 145 2220-2384 102-264 (397)
128 KOG2096 WD40 repeat protein [G 99.0 1.9E-09 4.1E-14 126.3 13.9 116 2221-2351 189-307 (420)
129 KOG1063 RNA polymerase II elon 99.0 9.6E-10 2.1E-14 137.8 12.3 144 2220-2378 526-676 (764)
130 KOG0639 Transducin-like enhanc 99.0 5.1E-10 1.1E-14 135.9 9.4 139 2223-2384 513-651 (705)
131 KOG0303 Actin-binding protein 99.0 3.4E-09 7.3E-14 126.9 16.0 144 2189-2351 91-248 (472)
132 KOG0294 WD40 repeat-containing 99.0 3.2E-09 6.9E-14 124.7 15.2 165 2195-2377 56-260 (362)
133 KOG0270 WD40 repeat-containing 99.0 3.1E-09 6.6E-14 128.8 15.4 172 2192-2382 256-434 (463)
134 KOG1446 Histone H3 (Lys4) meth 99.0 4.5E-09 9.7E-14 123.8 15.7 164 2200-2384 77-250 (311)
135 KOG0270 WD40 repeat-containing 99.0 2.3E-09 5E-14 129.9 12.8 136 2224-2378 248-385 (463)
136 KOG0641 WD40 repeat protein [G 99.0 4.3E-09 9.4E-14 118.8 14.1 145 2191-2351 193-348 (350)
137 KOG2096 WD40 repeat protein [G 99.0 1.5E-08 3.3E-13 119.0 18.6 210 36-285 84-308 (420)
138 KOG1445 Tumor-specific antigen 99.0 8.4E-10 1.8E-14 136.1 8.2 120 2221-2352 629-750 (1012)
139 KOG1007 WD repeat protein TSSC 99.0 3.7E-09 8E-14 122.9 12.7 144 2221-2379 125-271 (370)
140 KOG4328 WD40 protein [Function 99.0 2.6E-09 5.6E-14 129.7 11.9 161 2215-2385 182-388 (498)
141 KOG1445 Tumor-specific antigen 99.0 3.4E-09 7.4E-14 130.9 12.7 150 2226-2386 586-740 (1012)
142 COG2319 FOG: WD40 repeat [Gene 99.0 1.3E-08 2.9E-13 114.3 16.5 139 2222-2382 112-257 (466)
143 KOG0305 Anaphase promoting com 99.0 1.3E-08 2.9E-13 127.5 18.0 203 33-291 255-467 (484)
144 KOG1539 WD repeat protein [Gen 98.9 2.2E-09 4.8E-14 136.6 10.7 142 2189-2350 502-646 (910)
145 PF08662 eIF2A: Eukaryotic tra 98.9 1.3E-08 2.9E-13 114.7 15.8 139 2223-2383 9-160 (194)
146 KOG1274 WD40 repeat protein [G 98.9 6.2E-09 1.3E-13 133.9 14.5 141 2221-2382 98-248 (933)
147 KOG2048 WD40 repeat protein [G 98.9 8.1E-09 1.8E-13 129.7 14.3 147 2220-2383 111-262 (691)
148 KOG0771 Prolactin regulatory e 98.9 5.9E-09 1.3E-13 126.1 12.2 144 2223-2383 148-341 (398)
149 KOG1007 WD repeat protein TSSC 98.9 5.4E-09 1.2E-13 121.6 11.1 139 2223-2378 174-342 (370)
150 KOG4328 WD40 protein [Function 98.9 2.6E-08 5.5E-13 121.3 16.6 145 2191-2351 246-398 (498)
151 KOG0290 Conserved WD40 repeat- 98.9 6.7E-08 1.5E-12 112.9 19.0 255 7-289 11-322 (364)
152 KOG0307 Vesicle coat complex C 98.9 5.1E-09 1.1E-13 137.2 10.7 176 2193-2383 81-271 (1049)
153 KOG0642 Cell-cycle nuclear pro 98.9 4.2E-09 9.2E-14 130.3 9.3 118 2221-2352 296-426 (577)
154 KOG0321 WD40 repeat-containing 98.9 8.3E-09 1.8E-13 128.8 11.4 163 2210-2385 93-290 (720)
155 KOG0646 WD40 repeat protein [G 98.9 1.9E-08 4.1E-13 122.8 13.7 159 2199-2374 148-327 (476)
156 KOG1036 Mitotic spindle checkp 98.8 2.5E-08 5.5E-13 117.3 14.1 110 2221-2352 15-124 (323)
157 KOG4283 Transcription-coupled 98.8 1.2E-08 2.7E-13 118.8 11.2 147 2189-2351 111-275 (397)
158 KOG1009 Chromatin assembly com 98.8 4E-08 8.6E-13 118.6 15.1 156 95-280 14-190 (434)
159 KOG2394 WD40 protein DMR-N9 [G 98.8 8.5E-09 1.8E-13 126.9 9.5 92 2221-2327 292-383 (636)
160 KOG0268 Sof1-like rRNA process 98.8 7.3E-09 1.6E-13 123.2 8.6 114 2221-2352 231-345 (433)
161 KOG1523 Actin-related protein 98.8 5.2E-08 1.1E-12 115.1 14.9 155 96-284 12-175 (361)
162 KOG0268 Sof1-like rRNA process 98.8 7.2E-09 1.6E-13 123.3 7.8 162 2203-2384 167-333 (433)
163 KOG1036 Mitotic spindle checkp 98.8 3.9E-08 8.4E-13 115.8 13.6 183 2176-2379 11-287 (323)
164 KOG0649 WD40 repeat protein [G 98.8 5E-08 1.1E-12 111.8 14.1 152 2196-2366 83-249 (325)
165 PRK01742 tolB translocation pr 98.8 2.8E-08 6.1E-13 123.6 13.0 139 2221-2383 205-349 (429)
166 KOG0644 Uncharacterized conser 98.8 2.7E-09 5.8E-14 135.2 4.0 109 2221-2352 192-300 (1113)
167 KOG1273 WD40 repeat protein [G 98.8 7.3E-08 1.6E-12 113.4 14.0 155 2215-2385 19-215 (405)
168 PRK05137 tolB translocation pr 98.7 1.8E-07 3.9E-12 116.5 16.7 141 2221-2382 203-349 (435)
169 KOG0650 WD40 repeat nucleolar 98.7 1.6E-07 3.5E-12 116.9 15.4 144 2221-2379 402-579 (733)
170 KOG1188 WD40 repeat protein [G 98.7 1.2E-07 2.5E-12 112.8 11.6 139 2195-2352 51-196 (376)
171 KOG0650 WD40 repeat nucleolar 98.6 7E-07 1.5E-11 111.4 18.6 235 16-283 369-678 (733)
172 PRK11028 6-phosphogluconolacto 98.6 5.8E-07 1.3E-11 107.2 16.6 154 2222-2385 128-292 (330)
173 KOG0322 G-protein beta subunit 98.6 3.8E-08 8.3E-13 113.8 6.0 76 2215-2300 247-322 (323)
174 KOG0290 Conserved WD40 repeat- 98.6 1.7E-07 3.7E-12 109.6 11.3 120 2221-2352 152-318 (364)
175 KOG1272 WD40-repeat-containing 98.6 3.6E-08 7.7E-13 120.2 5.8 143 2220-2384 210-352 (545)
176 KOG2055 WD40 repeat protein [G 98.6 1.4E-07 3.1E-12 115.1 10.9 149 2221-2382 346-499 (514)
177 KOG2919 Guanine nucleotide-bin 98.6 1.6E-07 3.4E-12 111.0 10.5 145 2227-2387 119-271 (406)
178 PRK02889 tolB translocation pr 98.6 3.3E-07 7.2E-12 114.3 14.1 144 2221-2383 197-344 (427)
179 KOG0974 WD-repeat protein WDR6 98.6 1.2E-07 2.6E-12 123.8 10.4 112 2220-2352 176-288 (967)
180 KOG4378 Nuclear protein COP1 [ 98.6 3.9E-07 8.5E-12 111.6 13.9 160 2195-2380 94-264 (673)
181 KOG0649 WD40 repeat protein [G 98.6 3.2E-07 7E-12 105.4 12.3 138 2220-2377 63-219 (325)
182 KOG1310 WD40 repeat protein [G 98.6 1.3E-07 2.7E-12 116.7 9.4 122 2220-2354 51-180 (758)
183 KOG1408 WD40 repeat protein [F 98.6 3.3E-07 7.2E-12 115.2 12.3 154 2220-2384 460-701 (1080)
184 KOG2919 Guanine nucleotide-bin 98.5 3.4E-07 7.3E-12 108.3 11.4 137 2222-2377 210-351 (406)
185 PRK03629 tolB translocation pr 98.5 8.8E-07 1.9E-11 110.8 15.3 142 2221-2383 200-347 (429)
186 KOG4378 Nuclear protein COP1 [ 98.5 7.3E-07 1.6E-11 109.3 13.8 137 2221-2378 166-305 (673)
187 KOG2394 WD40 protein DMR-N9 [G 98.5 5.4E-07 1.2E-11 111.6 12.7 150 2214-2376 214-384 (636)
188 KOG1188 WD40 repeat protein [G 98.5 3.6E-07 7.8E-12 108.9 10.5 133 2232-2379 41-178 (376)
189 KOG0307 Vesicle coat complex C 98.5 2.7E-07 6E-12 121.5 9.6 168 2191-2376 128-306 (1049)
190 KOG1538 Uncharacterized conser 98.5 8E-07 1.7E-11 111.1 12.7 139 2221-2377 14-187 (1081)
191 KOG1408 WD40 repeat protein [F 98.5 1E-06 2.2E-11 111.1 13.6 117 2219-2351 596-712 (1080)
192 PRK04922 tolB translocation pr 98.5 1.1E-06 2.4E-11 109.7 14.1 140 2222-2382 206-351 (433)
193 KOG4547 WD40 repeat-containing 98.5 8.7E-07 1.9E-11 111.2 12.8 105 2267-2384 98-207 (541)
194 PRK01742 tolB translocation pr 98.5 5.6E-07 1.2E-11 112.2 11.2 124 2238-2382 181-307 (429)
195 PRK11028 6-phosphogluconolacto 98.5 2.4E-06 5.2E-11 102.1 15.9 140 2222-2374 177-327 (330)
196 TIGR02800 propeller_TolB tol-p 98.5 2.3E-06 5E-11 104.7 15.8 139 2222-2383 192-338 (417)
197 KOG2106 Uncharacterized conser 98.4 2.3E-06 4.9E-11 105.6 14.9 138 2222-2384 371-509 (626)
198 KOG1524 WD40 repeat-containing 98.4 5.1E-06 1.1E-10 102.9 16.8 211 54-338 77-291 (737)
199 KOG2055 WD40 repeat protein [G 98.4 1.8E-06 3.8E-11 105.9 12.6 159 2204-2385 200-363 (514)
200 KOG1273 WD40 repeat protein [G 98.4 1E-06 2.2E-11 104.1 9.5 92 2274-2377 26-117 (405)
201 KOG0974 WD-repeat protein WDR6 98.4 1.9E-06 4.2E-11 113.0 12.9 135 2223-2380 137-272 (967)
202 KOG0642 Cell-cycle nuclear pro 98.4 2.1E-06 4.6E-11 107.2 12.3 155 2220-2383 345-548 (577)
203 KOG0644 Uncharacterized conser 98.3 1.9E-07 4E-12 119.2 2.9 99 2268-2377 187-285 (1113)
204 KOG4227 WD40 repeat protein [G 98.3 3.6E-06 7.8E-11 101.0 13.1 138 2221-2377 58-205 (609)
205 KOG2110 Uncharacterized conser 98.3 4.8E-06 1E-10 100.3 14.0 112 2221-2351 131-247 (391)
206 KOG1538 Uncharacterized conser 98.3 1.6E-05 3.5E-10 100.0 18.3 193 40-286 14-212 (1081)
207 KOG2048 WD40 repeat protein [G 98.3 8.5E-06 1.8E-10 103.5 16.2 145 2221-2385 27-173 (691)
208 KOG2110 Uncharacterized conser 98.3 1.1E-05 2.3E-10 97.5 15.9 140 2221-2381 89-233 (391)
209 PRK03629 tolB translocation pr 98.3 6.3E-06 1.4E-10 103.3 14.8 140 2223-2384 246-391 (429)
210 KOG0771 Prolactin regulatory e 98.3 1.9E-06 4.2E-11 104.9 9.5 151 2189-2351 153-353 (398)
211 KOG0322 G-protein beta subunit 98.3 1.4E-06 3E-11 101.4 7.7 113 2221-2351 207-322 (323)
212 PRK05137 tolB translocation pr 98.3 7.2E-06 1.6E-10 102.5 14.1 138 2223-2382 249-392 (435)
213 PRK00178 tolB translocation pr 98.2 1.4E-05 3E-10 99.3 16.2 139 2221-2382 200-346 (430)
214 PRK04922 tolB translocation pr 98.2 8.3E-06 1.8E-10 102.0 13.7 139 2223-2383 251-395 (433)
215 PRK04792 tolB translocation pr 98.2 1.5E-05 3.2E-10 100.6 15.4 140 2222-2382 220-365 (448)
216 KOG1524 WD40 repeat-containing 98.2 4.4E-06 9.5E-11 103.5 9.7 139 2221-2383 106-244 (737)
217 KOG3914 WD repeat protein WDR4 98.2 3.6E-06 7.9E-11 102.2 8.8 119 2222-2363 113-232 (390)
218 KOG2139 WD40 repeat protein [G 98.2 3.4E-05 7.3E-10 93.0 16.4 151 38-207 140-301 (445)
219 PRK01029 tolB translocation pr 98.2 0.00011 2.3E-09 92.7 21.4 200 42-290 188-407 (428)
220 KOG2139 WD40 repeat protein [G 98.2 2.9E-05 6.4E-10 93.5 15.4 186 56-286 113-310 (445)
221 KOG0321 WD40 repeat-containing 98.1 4.2E-06 9.1E-11 105.5 8.3 115 2225-2352 55-175 (720)
222 PRK02889 tolB translocation pr 98.1 1.4E-05 3.1E-10 99.9 13.0 141 2223-2383 243-387 (427)
223 KOG1517 Guanine nucleotide bin 98.1 6.1E-05 1.3E-09 99.1 18.4 134 2222-2376 1211-1361(1387)
224 PRK01029 tolB translocation pr 98.1 2.7E-05 5.9E-10 97.9 14.8 143 2224-2382 235-386 (428)
225 KOG4497 Uncharacterized conser 98.1 2.5E-05 5.5E-10 93.0 13.1 193 44-283 14-238 (447)
226 KOG1310 WD40 repeat protein [G 98.1 6.4E-06 1.4E-10 102.2 8.5 132 139-290 43-183 (758)
227 KOG2106 Uncharacterized conser 98.1 4.8E-05 1E-09 94.4 15.6 133 2197-2351 183-315 (626)
228 KOG1523 Actin-related protein 98.1 4.5E-05 9.8E-10 91.1 14.0 142 2221-2378 12-168 (361)
229 PF00400 WD40: WD domain, G-be 98.0 9.4E-06 2E-10 68.3 5.7 39 2251-2299 1-39 (39)
230 KOG1587 Cytoplasmic dynein int 97.9 0.00018 4E-09 93.0 17.5 148 2220-2379 348-499 (555)
231 TIGR02800 propeller_TolB tol-p 97.9 8.7E-05 1.9E-09 91.1 14.0 139 2223-2383 237-381 (417)
232 KOG1240 Protein kinase contain 97.9 6.1E-05 1.3E-09 100.4 12.5 146 2225-2383 1055-1212(1431)
233 PRK04792 tolB translocation pr 97.9 0.00064 1.4E-08 86.2 20.7 198 41-292 220-430 (448)
234 KOG1963 WD40 repeat protein [G 97.9 5.9E-05 1.3E-09 98.4 11.5 132 2199-2351 184-321 (792)
235 KOG2111 Uncharacterized conser 97.8 9.6E-05 2.1E-09 88.3 10.4 105 2233-2352 150-256 (346)
236 KOG2111 Uncharacterized conser 97.8 8.4E-05 1.8E-09 88.8 9.8 75 2221-2303 183-258 (346)
237 KOG4547 WD40 repeat-containing 97.8 0.00024 5.3E-09 90.0 14.2 130 2220-2369 103-239 (541)
238 KOG3881 Uncharacterized conser 97.7 0.0002 4.2E-09 87.5 12.5 121 2220-2360 203-326 (412)
239 KOG2321 WD40 repeat protein [G 97.7 0.00014 3.1E-09 91.4 10.9 146 2220-2378 176-325 (703)
240 KOG1517 Guanine nucleotide bin 97.7 0.00029 6.3E-09 93.1 14.1 140 2225-2379 1171-1317(1387)
241 KOG1963 WD40 repeat protein [G 97.7 0.00029 6.4E-09 92.2 14.1 142 2223-2380 164-306 (792)
242 KOG4227 WD40 repeat protein [G 97.7 0.00037 8E-09 84.4 13.2 180 2191-2384 67-262 (609)
243 PF04762 IKI3: IKI3 family; I 97.7 0.0057 1.2E-07 84.1 26.0 238 37-342 74-367 (928)
244 KOG1272 WD40-repeat-containing 97.7 6.7E-05 1.4E-09 92.6 7.0 109 2221-2351 253-361 (545)
245 KOG2315 Predicted translation 97.6 0.00021 4.5E-09 90.1 10.4 130 95-252 271-410 (566)
246 PF02239 Cytochrom_D1: Cytochr 97.6 0.00073 1.6E-08 84.0 15.1 129 2234-2383 9-145 (369)
247 PF00400 WD40: WD domain, G-be 97.6 0.00013 2.8E-09 61.4 6.0 38 2309-2350 2-39 (39)
248 PF02239 Cytochrom_D1: Cytochr 97.6 0.0022 4.8E-08 79.8 18.2 136 2224-2382 41-187 (369)
249 PRK00178 tolB translocation pr 97.5 0.001 2.2E-08 83.1 14.2 118 2242-2382 180-302 (430)
250 PF10282 Lactonase: Lactonase, 97.5 0.0043 9.3E-08 76.1 19.2 127 2222-2357 194-327 (345)
251 KOG1587 Cytoplasmic dynein int 97.5 0.00034 7.3E-09 90.6 10.0 116 2219-2351 398-515 (555)
252 KOG0309 Conserved WD40 repeat- 97.5 0.00039 8.4E-09 89.2 10.0 194 41-286 27-233 (1081)
253 KOG3881 Uncharacterized conser 97.4 0.0009 2E-08 81.9 11.9 151 2222-2383 151-307 (412)
254 KOG2315 Predicted translation 97.3 0.0052 1.1E-07 78.1 17.3 225 2129-2383 128-371 (566)
255 KOG1334 WD40 repeat protein [G 97.3 0.00063 1.4E-08 84.8 9.3 117 2222-2352 145-263 (559)
256 KOG3914 WD repeat protein WDR4 97.3 0.00037 7.9E-09 85.5 6.7 73 2222-2304 154-226 (390)
257 PLN02919 haloacid dehalogenase 97.3 0.0033 7.1E-08 87.5 16.5 119 2223-2351 743-887 (1057)
258 PRK04043 tolB translocation pr 97.3 0.019 4.2E-07 72.8 21.7 200 42-290 191-403 (419)
259 PF10282 Lactonase: Lactonase, 97.2 0.0099 2.2E-07 72.9 18.5 153 2221-2386 145-311 (345)
260 KOG4190 Uncharacterized conser 97.2 0.00068 1.5E-08 84.4 8.0 156 2203-2381 724-891 (1034)
261 PLN02919 haloacid dehalogenase 97.2 0.0067 1.4E-07 84.5 18.2 149 2223-2383 686-875 (1057)
262 KOG4497 Uncharacterized conser 97.2 0.0013 2.7E-08 79.2 9.1 134 2225-2381 14-148 (447)
263 PRK04043 tolB translocation pr 97.1 0.0057 1.2E-07 77.4 15.1 136 2222-2382 190-334 (419)
264 KOG1912 WD40 repeat protein [G 97.1 0.002 4.3E-08 83.5 10.9 143 29-198 5-165 (1062)
265 KOG1240 Protein kinase contain 97.0 0.0094 2E-07 80.8 16.4 165 2189-2363 1058-1282(1431)
266 KOG0280 Uncharacterized conser 96.9 0.0094 2E-07 71.5 13.1 137 2223-2377 125-264 (339)
267 KOG2695 WD40 repeat protein [G 96.8 0.0016 3.5E-08 78.8 6.3 134 2223-2375 256-401 (425)
268 KOG1354 Serine/threonine prote 96.7 0.0022 4.8E-08 77.6 6.5 140 2217-2366 162-314 (433)
269 KOG0280 Uncharacterized conser 96.7 0.006 1.3E-07 73.0 9.7 96 2220-2329 166-264 (339)
270 KOG2079 Vacuolar assembly/sort 96.6 0.0065 1.4E-07 81.5 9.5 107 2217-2337 85-193 (1206)
271 KOG4714 Nucleoporin [Nuclear s 96.6 0.0041 8.9E-08 73.5 6.8 73 2272-2351 180-253 (319)
272 KOG2314 Translation initiation 96.5 0.016 3.5E-07 73.6 11.6 168 45-252 170-356 (698)
273 smart00320 WD40 WD40 repeats. 96.4 0.0076 1.7E-07 46.3 5.6 30 2270-2299 11-40 (40)
274 PF15492 Nbas_N: Neuroblastoma 96.4 0.046 1E-06 65.8 14.4 122 2223-2351 47-258 (282)
275 KOG0309 Conserved WD40 repeat- 96.4 0.0071 1.5E-07 78.3 8.0 133 2223-2374 71-209 (1081)
276 COG2706 3-carboxymuconate cycl 96.2 0.17 3.7E-06 62.5 17.8 151 2223-2382 92-259 (346)
277 KOG1409 Uncharacterized conser 96.2 0.014 3.1E-07 71.0 8.4 74 2221-2303 199-272 (404)
278 PF11768 DUF3312: Protein of u 96.0 0.021 4.5E-07 73.6 9.4 69 2272-2351 260-328 (545)
279 PF04762 IKI3: IKI3 family; I 96.0 0.46 1E-05 66.2 22.4 164 97-286 259-457 (928)
280 COG2706 3-carboxymuconate cycl 95.9 0.18 3.9E-06 62.3 16.2 128 2221-2356 192-325 (346)
281 COG5170 CDC55 Serine/threonine 95.9 0.011 2.4E-07 71.0 5.8 140 2217-2366 170-322 (460)
282 KOG1354 Serine/threonine prote 95.9 0.021 4.5E-07 69.6 8.1 136 2222-2368 216-374 (433)
283 KOG4190 Uncharacterized conser 95.9 0.0057 1.2E-07 76.7 3.5 79 2268-2352 732-812 (1034)
284 KOG4532 WD40-like repeat conta 95.6 0.18 3.8E-06 60.5 13.7 128 2234-2378 131-262 (344)
285 KOG2321 WD40 repeat protein [G 95.5 0.09 1.9E-06 67.5 12.0 116 2223-2352 137-258 (703)
286 COG4946 Uncharacterized protei 95.5 0.24 5.2E-06 62.7 15.1 139 2221-2380 361-502 (668)
287 PF11768 DUF3312: Protein of u 95.3 0.049 1.1E-06 70.4 8.9 71 2221-2303 261-331 (545)
288 KOG1334 WD40 repeat protein [G 95.3 0.026 5.6E-07 71.2 6.1 106 2269-2382 140-248 (559)
289 PF08450 SGL: SMP-30/Gluconola 95.2 0.66 1.4E-05 54.1 17.2 141 2220-2379 86-238 (246)
290 KOG4714 Nucleoporin [Nuclear s 95.2 0.014 3.1E-07 69.1 3.4 73 2221-2302 181-255 (319)
291 KOG4532 WD40-like repeat conta 95.1 0.16 3.5E-06 60.8 11.4 113 2221-2351 160-281 (344)
292 KOG2066 Vacuolar assembly/sort 95.1 0.14 3.1E-06 67.9 12.0 112 2228-2363 80-196 (846)
293 smart00320 WD40 WD40 repeats. 94.9 0.054 1.2E-06 41.5 5.0 38 2309-2350 3-40 (40)
294 TIGR02658 TTQ_MADH_Hv methylam 94.4 0.86 1.9E-05 57.3 16.2 102 2241-2363 27-145 (352)
295 COG4946 Uncharacterized protei 94.3 0.86 1.9E-05 58.0 15.5 103 2267-2381 355-458 (668)
296 KOG1920 IkappaB kinase complex 94.0 3.6 7.8E-05 57.6 21.6 92 1315-1410 943-1038(1265)
297 KOG2041 WD40 repeat protein [G 93.9 0.36 7.8E-06 63.2 11.6 102 54-166 27-136 (1189)
298 COG0823 TolB Periplasmic compo 93.8 0.23 5E-06 63.6 10.0 143 2220-2383 193-342 (425)
299 PF07433 DUF1513: Protein of u 93.6 1.5 3.2E-05 54.3 15.7 148 2223-2384 102-274 (305)
300 PF02897 Peptidase_S9_N: Proly 93.6 2.4 5.1E-05 53.4 18.1 143 2220-2377 124-287 (414)
301 PF08450 SGL: SMP-30/Gluconola 93.1 2.4 5.3E-05 49.5 16.1 137 2224-2381 4-148 (246)
302 KOG1409 Uncharacterized conser 93.0 1 2.2E-05 55.8 13.0 158 2200-2373 43-247 (404)
303 KOG1920 IkappaB kinase complex 93.0 1.9 4.2E-05 60.0 16.5 117 1258-1383 948-1067(1265)
304 COG5354 Uncharacterized protei 92.9 0.32 7E-06 62.2 8.9 137 2218-2380 31-187 (561)
305 KOG2314 Translation initiation 92.6 0.52 1.1E-05 60.8 10.1 106 2223-2351 214-333 (698)
306 PF12657 TFIIIC_delta: Transcr 92.4 1.3 2.8E-05 50.1 12.1 99 38-143 4-135 (173)
307 KOG2041 WD40 repeat protein [G 92.3 0.62 1.3E-05 61.2 10.3 122 2217-2347 12-140 (1189)
308 TIGR02658 TTQ_MADH_Hv methylam 92.3 2.6 5.7E-05 53.2 15.6 121 2226-2362 200-338 (352)
309 PF14783 BBS2_Mid: Ciliary BBS 92.2 3 6.4E-05 45.1 13.6 65 2222-2300 2-70 (111)
310 KOG1645 RING-finger-containing 92.0 0.25 5.4E-06 61.8 6.3 99 2268-2376 190-291 (463)
311 KOG1645 RING-finger-containing 91.9 0.56 1.2E-05 58.9 9.0 111 2222-2352 196-315 (463)
312 KOG1912 WD40 repeat protein [G 91.6 1 2.2E-05 60.1 11.0 128 2223-2372 19-161 (1062)
313 KOG3617 WD40 and TPR repeat-co 91.4 0.35 7.6E-06 64.3 6.8 107 2225-2352 21-131 (1416)
314 KOG4640 Anaphase-promoting com 91.4 0.58 1.3E-05 61.3 8.7 75 2220-2304 21-95 (665)
315 PRK02888 nitrous-oxide reducta 90.9 1.8 3.8E-05 57.9 12.5 143 2228-2386 285-451 (635)
316 PF15492 Nbas_N: Neuroblastoma 90.8 18 0.00039 44.6 19.7 213 29-285 34-259 (282)
317 PF07433 DUF1513: Protein of u 90.8 1.7 3.7E-05 53.7 11.6 143 2223-2379 8-175 (305)
318 KOG2695 WD40 repeat protein [G 90.4 0.4 8.7E-06 59.2 5.8 118 2235-2370 228-348 (425)
319 KOG1832 HIV-1 Vpr-binding prot 90.3 0.33 7.1E-06 64.8 5.2 105 2270-2386 1100-1205(1516)
320 COG5354 Uncharacterized protei 89.7 3.1 6.7E-05 53.9 12.7 136 2224-2382 227-375 (561)
321 TIGR03300 assembly_YfgL outer 89.6 2.3 4.9E-05 52.8 11.5 113 2231-2370 241-354 (377)
322 PF08553 VID27: VID27 cytoplas 88.9 2.3 5E-05 58.3 11.6 129 2236-2386 499-638 (794)
323 PF00930 DPPIV_N: Dipeptidyl p 88.4 0.82 1.8E-05 56.7 6.6 105 2228-2351 1-130 (353)
324 KOG1916 Nuclear protein, conta 88.4 0.3 6.4E-06 65.5 2.8 133 2222-2375 183-342 (1283)
325 PF12657 TFIIIC_delta: Transcr 87.8 3.9 8.5E-05 46.4 10.9 82 98-183 8-134 (173)
326 COG5170 CDC55 Serine/threonine 87.6 2.1 4.5E-05 52.6 8.9 127 2221-2352 28-201 (460)
327 PRK13616 lipoprotein LpqB; Pro 87.3 2.5 5.4E-05 56.6 10.4 102 2221-2348 351-472 (591)
328 KOG3617 WD40 and TPR repeat-co 87.0 0.78 1.7E-05 61.3 5.3 81 2212-2302 51-132 (1416)
329 PF10647 Gmad1: Lipoprotein Lp 86.5 6.8 0.00015 47.1 12.5 113 2222-2351 26-143 (253)
330 PRK13616 lipoprotein LpqB; Pro 86.4 4 8.7E-05 54.7 11.5 144 2223-2376 400-550 (591)
331 TIGR03300 assembly_YfgL outer 86.0 4.3 9.2E-05 50.4 10.9 98 2230-2349 278-376 (377)
332 PF13360 PQQ_2: PQQ-like domai 85.0 8.9 0.00019 43.8 12.0 141 2199-2366 8-152 (238)
333 KOG1832 HIV-1 Vpr-binding prot 84.9 0.7 1.5E-05 61.9 3.5 135 2223-2381 1105-1245(1516)
334 KOG2444 WD40 repeat protein [G 84.4 2.4 5.1E-05 50.6 7.1 105 2232-2351 71-176 (238)
335 PF02897 Peptidase_S9_N: Proly 82.9 7.1 0.00015 49.2 11.0 102 2273-2382 125-242 (414)
336 KOG3621 WD40 repeat-containing 82.9 8.8 0.00019 51.6 11.9 140 2221-2376 35-180 (726)
337 COG0823 TolB Periplasmic compo 82.7 6.8 0.00015 50.8 10.8 139 42-207 196-345 (425)
338 PF13360 PQQ_2: PQQ-like domai 82.5 7 0.00015 44.6 9.9 102 2239-2362 1-102 (238)
339 COG3391 Uncharacterized conser 82.2 27 0.00058 44.5 15.7 140 2223-2382 119-268 (381)
340 PRK02888 nitrous-oxide reducta 81.0 11 0.00023 50.9 11.9 56 2292-2351 295-350 (635)
341 PF12234 Rav1p_C: RAVE protein 80.5 9.5 0.00021 51.5 11.3 25 1386-1410 465-490 (631)
342 PRK10115 protease 2; Provision 80.2 35 0.00076 46.9 16.7 117 2220-2351 127-254 (686)
343 KOG1275 PAB-dependent poly(A) 80.2 5.2 0.00011 54.8 8.6 102 2230-2351 146-253 (1118)
344 KOG1275 PAB-dependent poly(A) 79.9 6.6 0.00014 53.8 9.4 104 2227-2351 183-295 (1118)
345 KOG2066 Vacuolar assembly/sort 78.9 12 0.00025 51.1 11.1 98 2223-2350 43-144 (846)
346 KOG2395 Protein involved in va 78.8 8.8 0.00019 50.3 9.7 135 2230-2386 344-491 (644)
347 PF07995 GSDH: Glucose / Sorbo 78.1 15 0.00032 46.0 11.3 111 2223-2339 5-133 (331)
348 KOG2079 Vacuolar assembly/sort 77.6 5.4 0.00012 55.4 7.8 72 2220-2300 131-202 (1206)
349 PF12894 Apc4_WD40: Anaphase-p 77.2 4.4 9.6E-05 37.6 4.9 33 2221-2254 13-45 (47)
350 KOG2114 Vacuolar assembly/sort 76.3 26 0.00056 48.4 13.2 111 2226-2350 30-153 (933)
351 PF10647 Gmad1: Lipoprotein Lp 76.2 32 0.0007 41.5 13.1 115 2223-2348 69-192 (253)
352 PF14870 PSII_BNR: Photosynthe 76.1 24 0.00052 44.1 12.2 105 2221-2338 146-251 (302)
353 PF10168 Nup88: Nuclear pore c 75.7 9.7 0.00021 52.3 9.5 88 36-126 82-179 (717)
354 TIGR02604 Piru_Ver_Nterm putat 75.0 34 0.00074 43.2 13.4 148 2223-2384 17-201 (367)
355 KOG2444 WD40 repeat protein [G 74.8 5.5 0.00012 47.7 6.1 68 2225-2302 108-178 (238)
356 KOG2114 Vacuolar assembly/sort 74.3 41 0.00089 46.6 14.2 132 2221-2372 127-262 (933)
357 PF08553 VID27: VID27 cytoplas 73.9 27 0.00058 48.6 12.9 104 2234-2355 545-650 (794)
358 PLN00033 photosystem II stabil 73.9 70 0.0015 41.6 15.9 144 44-207 244-390 (398)
359 KOG0882 Cyclophilin-related pe 72.4 7.2 0.00016 50.1 6.6 144 2227-2384 16-162 (558)
360 PF12894 Apc4_WD40: Anaphase-p 72.2 7.5 0.00016 36.1 5.0 30 2272-2301 12-41 (47)
361 PF14783 BBS2_Mid: Ciliary BBS 71.5 59 0.0013 35.6 12.2 99 97-210 2-107 (111)
362 PF11715 Nup160: Nucleoporin N 70.6 14 0.0003 48.8 9.0 36 2223-2258 218-257 (547)
363 COG3391 Uncharacterized conser 70.4 72 0.0016 40.8 14.8 136 2223-2382 77-222 (381)
364 PF04053 Coatomer_WDAD: Coatom 68.8 9.2 0.0002 49.8 6.7 86 1244-1362 356-441 (443)
365 PF06977 SdiA-regulated: SdiA- 67.6 60 0.0013 39.7 12.6 184 2186-2381 15-236 (248)
366 KOG1008 Uncharacterized conser 66.9 2.7 5.8E-05 55.6 1.4 112 2223-2351 158-274 (783)
367 KOG3621 WD40 repeat-containing 66.7 12 0.00025 50.5 7.0 108 2222-2336 79-186 (726)
368 KOG1008 Uncharacterized conser 66.2 2.1 4.6E-05 56.5 0.3 139 2223-2378 106-255 (783)
369 KOG4640 Anaphase-promoting com 65.2 19 0.0004 48.3 8.3 78 2272-2361 21-99 (665)
370 PF00930 DPPIV_N: Dipeptidyl p 65.1 50 0.0011 41.4 11.8 155 2221-2386 185-347 (353)
371 COG3386 Gluconolactonase [Carb 61.1 1.4E+02 0.0029 37.7 14.4 135 2223-2374 114-262 (307)
372 PF08596 Lgl_C: Lethal giant l 60.4 1.1E+02 0.0024 39.8 13.7 147 2219-2375 1-201 (395)
373 PF04053 Coatomer_WDAD: Coatom 59.1 51 0.0011 43.3 10.7 99 2224-2351 73-172 (443)
374 smart00299 CLH Clathrin heavy 58.3 22 0.00047 38.4 6.2 60 1293-1361 57-121 (140)
375 TIGR02604 Piru_Ver_Nterm putat 58.2 80 0.0017 40.0 12.0 101 2223-2336 75-200 (367)
376 COG3490 Uncharacterized protei 58.0 87 0.0019 39.3 11.5 102 2223-2337 71-179 (366)
377 PF14870 PSII_BNR: Photosynthe 56.7 1.3E+02 0.0029 37.8 13.2 105 95-207 187-295 (302)
378 KOG0882 Cyclophilin-related pe 56.2 39 0.00085 43.9 8.6 117 2233-2363 114-240 (558)
379 PRK11138 outer membrane biogen 52.7 92 0.002 39.5 11.3 105 2231-2363 256-362 (394)
380 PF03178 CPSF_A: CPSF A subuni 52.5 98 0.0021 38.2 11.2 112 2221-2352 90-202 (321)
381 PF10313 DUF2415: Uncharacteri 52.2 29 0.00064 32.2 4.9 30 2273-2302 2-34 (43)
382 PF10168 Nup88: Nuclear pore c 51.8 92 0.002 43.4 11.7 85 191-286 87-180 (717)
383 PF15390 DUF4613: Domain of un 51.6 2.4E+02 0.0051 38.6 14.5 130 141-312 52-200 (671)
384 PF00780 CNH: CNH domain; Int 51.5 2.3E+02 0.0051 33.7 13.8 128 2229-2375 5-147 (275)
385 PF07569 Hira: TUP1-like enhan 51.1 63 0.0014 38.6 8.9 73 2225-2302 16-96 (219)
386 PRK13684 Ycf48-like protein; P 49.6 1.9E+02 0.0042 36.4 13.2 110 2221-2347 174-283 (334)
387 PF04841 Vps16_N: Vps16, N-ter 49.4 2.8E+02 0.0061 36.2 14.9 131 2226-2387 185-316 (410)
388 TIGR03606 non_repeat_PQQ dehyd 47.7 2.2E+02 0.0048 37.9 13.7 110 2223-2338 33-164 (454)
389 PRK11138 outer membrane biogen 47.3 1.2E+02 0.0026 38.6 11.1 99 2230-2350 293-392 (394)
390 PF06977 SdiA-regulated: SdiA- 47.2 2.8E+02 0.006 34.2 13.5 116 2222-2351 24-146 (248)
391 PF15390 DUF4613: Domain of un 47.0 61 0.0013 43.7 8.4 98 802-917 80-184 (671)
392 KOG4460 Nuclear pore complex, 46.5 1.4E+02 0.0031 40.0 11.3 85 190-285 105-198 (741)
393 PF13449 Phytase-like: Esteras 46.3 1.8E+02 0.004 36.5 12.3 125 2224-2351 89-248 (326)
394 PRK11447 cellulose synthase su 45.2 7.2E+02 0.016 36.7 19.4 63 1463-1556 575-637 (1157)
395 PF14655 RAB3GAP2_N: Rab3 GTPa 43.5 83 0.0018 41.2 8.9 77 2221-2303 309-400 (415)
396 PLN00033 photosystem II stabil 43.4 4.5E+02 0.0098 34.5 15.3 133 2223-2377 242-381 (398)
397 PF12110 Nup96: Nuclear protei 43.4 32 0.0007 42.5 5.1 48 1325-1376 2-49 (290)
398 PF14761 HPS3_N: Hermansky-Pud 43.2 5.1E+02 0.011 31.7 14.4 126 110-285 29-163 (215)
399 KOG4460 Nuclear pore complex, 42.4 61 0.0013 43.0 7.3 82 41-126 106-198 (741)
400 PF12931 Sec16_C: Sec23-bindin 42.2 43 0.00093 41.3 6.0 75 1332-1411 5-85 (284)
401 PF05935 Arylsulfotrans: Aryls 41.4 2.6E+02 0.0056 37.2 13.0 124 2225-2367 153-314 (477)
402 PF07569 Hira: TUP1-like enhan 41.3 89 0.0019 37.4 8.2 69 2277-2351 16-94 (219)
403 KOG4441 Proteins containing BT 41.2 2.4E+02 0.0051 38.5 12.9 136 2197-2351 302-451 (571)
404 PF03178 CPSF_A: CPSF A subuni 39.6 8.3E+02 0.018 30.3 21.0 98 96-207 90-192 (321)
405 KOG4649 PQQ (pyrrolo-quinoline 37.4 2.2E+02 0.0049 35.5 10.5 71 2230-2316 62-133 (354)
406 TIGR03118 PEPCTERM_chp_1 conse 35.9 4.1E+02 0.0088 34.1 12.6 124 2217-2351 22-169 (336)
407 PF14583 Pectate_lyase22: Olig 34.1 4.2E+02 0.009 34.9 12.7 130 2198-2349 209-378 (386)
408 PF13449 Phytase-like: Esteras 33.0 6.2E+02 0.013 31.9 13.9 156 2223-2382 23-230 (326)
409 PF08728 CRT10: CRT10; InterP 32.9 2.4E+02 0.0053 39.4 11.0 114 2229-2351 112-245 (717)
410 KOG4499 Ca2+-binding protein R 32.1 6.9E+02 0.015 31.2 13.1 137 2223-2375 112-262 (310)
411 KOG3616 Selective LIM binding 30.2 75 0.0016 43.3 5.5 62 2222-2298 17-80 (1636)
412 PF14655 RAB3GAP2_N: Rab3 GTPa 30.1 2.9E+02 0.0064 36.4 10.7 32 2272-2303 308-339 (415)
413 PF13934 ELYS: Nuclear pore co 29.7 3E+02 0.0066 33.2 10.1 160 1241-1415 24-202 (226)
414 KOG2395 Protein involved in va 27.3 87 0.0019 41.8 5.3 58 2233-2301 443-500 (644)
415 cd00870 PI3Ka_III Phosphoinosi 25.9 3E+02 0.0066 32.0 8.8 116 1276-1399 30-161 (166)
416 KOG2377 Uncharacterized conser 25.6 1.7E+02 0.0037 38.7 7.3 30 2272-2301 67-96 (657)
417 PF10313 DUF2415: Uncharacteri 25.4 1.3E+02 0.0029 28.2 4.6 31 2221-2251 2-35 (43)
418 PF11715 Nup160: Nucleoporin N 25.2 1E+02 0.0022 41.0 5.7 33 2272-2304 215-251 (547)
419 KOG4659 Uncharacterized conser 24.8 2.8E+02 0.0061 40.8 9.5 16 894-909 370-385 (1899)
420 KOG3616 Selective LIM binding 24.3 2E+02 0.0043 39.7 7.7 134 1319-1485 1102-1237(1636)
421 KOG1897 Damage-specific DNA bi 23.5 4.1E+02 0.0088 38.3 10.5 150 2221-2382 716-884 (1096)
422 PRK11447 cellulose synthase su 23.3 6.9E+02 0.015 36.9 13.5 77 1332-1409 583-661 (1157)
423 PRK10370 formate-dependent nit 23.2 5.3E+02 0.011 30.3 10.3 74 1336-1409 87-168 (198)
424 PF05787 DUF839: Bacterial pro 22.7 7.2E+02 0.016 33.8 12.6 57 2068-2126 347-411 (524)
425 PRK10115 protease 2; Provision 22.6 4.4E+02 0.0095 36.8 10.9 101 2272-2383 127-239 (686)
426 PF07676 PD40: WD40-like Beta 22.4 1.2E+02 0.0027 26.1 3.9 22 144-165 7-28 (39)
427 PF08728 CRT10: CRT10; InterP 21.4 2E+02 0.0044 40.1 7.3 74 2220-2300 164-245 (717)
428 TIGR02917 PEP_TPR_lipo putativ 21.2 8.2E+02 0.018 33.1 12.8 65 1463-1554 195-259 (899)
429 PF07676 PD40: WD40-like Beta 21.1 2.2E+02 0.0047 24.6 5.1 30 2317-2349 7-38 (39)
430 PRK13615 lipoprotein LpqB; Pro 20.9 6E+02 0.013 34.9 11.3 114 2220-2351 334-448 (557)
431 PHA02713 hypothetical protein; 20.2 9.5E+02 0.021 32.8 13.0 85 2196-2293 320-409 (557)
No 1
>KOG1064 consensus RAVE (regulator of V-ATPase assembly) complex subunit RAV1/DMX protein, WD repeat superfamily [General function prediction only]
Probab=100.00 E-value=0 Score=3012.84 Aligned_cols=2154 Identities=24% Similarity=0.321 Sum_probs=1801.2
Q ss_pred ccccCCCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCC-CCeeEEEEcCCCCCC
Q 000080 31 EFIPTAPTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNS-LPVTSISWSPETPSI 109 (2389)
Q Consensus 31 ~~ip~ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~-~dVk~VaWSPd~~~~ 109 (2389)
-++|.||-+..+..+- ..+++++|+|||+|+.+||.- + +||++ |+||+..|+ ..|.+|+++-+ .
T Consensus 5 QvlpGa~n~g~~~y~~-gsi~~~pftay~sg~~vvIl~--n---~ferv------QiIp~~~~g~~~vsav~c~~~---t 69 (2439)
T KOG1064|consen 5 QVLPGAPNAGDNCYSV-GSIGDLPFTAYASGCDVVILT--N---DFERV------QIIPGAKHGNILVSAVDCSQQ---T 69 (2439)
T ss_pred cccCCCCCCCCCCcee-ceECCeeEEEeecCCceEEEc--C---CceeE------EeccccCcCceEEEEEeeccc---c
Confidence 3567777666655544 356688999999999999998 6 99999 999997775 77999999999 9
Q ss_pred CcEEEecCCeEEEEeeCC-CCCC----CCccceeeEEecccceEEEEeecCCCCeEEEEecceEEeec-------c----
Q 000080 110 GQLAAASENCIFVFAHDS-ASSK----GSFCWSQNAILVQGTKVEAIEWTGSGDGIVAGGMETVLWKK-------K---- 173 (2389)
Q Consensus 110 GeIaASyDntIRVw~~d~-~~~k----gd~~W~~~~tL~hssTV~sIAWSpdG~rLaSggdDV~IW~~-------~---- 173 (2389)
|.|||+|+|.|.||+|.. ...+ ..++|.+..+++|+++|-++.|+++|.|+++||+.+++|+. .
T Consensus 70 G~IA~sygn~v~I~eP~~i~s~k~n~~~~~~W~~t~qf~~~~~~~s~~w~~~~~rlltgs~~l~Lwq~~~~~~~~~~~~i 149 (2439)
T KOG1064|consen 70 GKIAASYGNVVSIFEPTNILSSKGNPHLAVQWVQTTQFFHDSTVVSLNWNFEGLRLLTGSDNLQLWQETINFSIEEPEEI 149 (2439)
T ss_pred ceeeeccCCeeeecCCcchhhhcCCcceeeeEEeeecccccccceeeeeccccchhhhcCcceEEEeccCCccccccccc
Confidence 999999999999999863 1122 34579999999999999999999999999999999999973 1
Q ss_pred -------CCcEEEEEEeeccccceEEEEeecCCCc-eEeeecccc-cccCCCCCCCceeEEEeeCCCccceeecccCCCC
Q 000080 174 -------NTLWEIAWKFKENYPQNLVSATWSIEGP-SATAASMSQ-LDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQP 244 (2389)
Q Consensus 174 -------~s~Wecvwt~~~~~~~~ivsvaWSpdG~-fATag~dik-f~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qd 244 (2389)
-..|||+|+++..++ ++..+|||||. |||+|.+-. .++|-.+. +-++.++..|.++|++||++
T Consensus 150 ~d~~l~~~~~We~iW~~k~~~~--v~~~~~SpDG~f~at~g~~dclaKvwy~~~------~~~~~~~~~f~~vyL~HP~~ 221 (2439)
T KOG1064|consen 150 TDTVLPKRRDWELIWSCKTPSP--VYSSTISPDGEFFATIGKRDCLAKVWYKST------VSQSGGEESFSFVYLPHPRR 221 (2439)
T ss_pred ccccccccccceEEEeccCCcc--eeEEEEcCCcceEEeccccCcchhhhcccc------cccccCccceeeEeccCCcc
Confidence 137999999987766 88889999999 888888443 33331000 11235667789999999999
Q ss_pred eeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeecCCcccccccccC------CCCccceeEEEEEEEeeccc
Q 000080 245 VSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMDSGKTRKVAKDTN------DHKTIRRSFCVGAIIEINQA 318 (2389)
Q Consensus 245 Vn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d~Gk~kk~~~~~~------d~~~~~~sF~vaA~I~~~~~ 318 (2389)
|++++||.+++||||+ +++|+|+|||.||++|||+|++.++.++.++... -|.++.+|||+||.|| +
T Consensus 222 Vs~~~WRktskymp~g----sv~nvL~T~C~D~v~RIW~et~~p~~~l~~~~~~~~~~~~~~~sa~~~f~~aadin--~- 294 (2439)
T KOG1064|consen 222 VSGFQWRKTSKYMPRG----SVSNVLMTCCLDNVCRIWCETDLPKDCLVMLTGFDHKMKSFHVSALCHFHIAADIN--P- 294 (2439)
T ss_pred cccceeccccccCCcc----chhhhHHhhhccCceEEEEEeccCCCeEeeeccccccccccccCCCcceEEEeecC--c-
Confidence 9999999999999999 7999999999999999999999998888666553 3567899999999999 7
Q ss_pred ccCCCCCCeEEEeecccccee--eccCCccceecccccccccceeeeeeEeecCCccceeEEEeeeccCCCCCcCeEEEe
Q 000080 319 LNGALGMDIVITWAKEIRCMF--ETGEGANHFISTGVYEHGGTGKCEWLVGYGPGSLVTLWAIHCLDDISPLRFPRVTLW 396 (2389)
Q Consensus 319 ~~~~l~~~~~v~W~~~~~~vf--~~~~e~~~~~~s~~~~~~~v~~~eW~~~~~PGs~l~~W~v~~LDd~~~~R~prVt~~ 396 (2389)
.|| +|.| |+||||+|| -+-|..++.++.++++...|+.|||+.|..||..+++|||||||||+||||||||||
T Consensus 295 ~tD----~F~v-Wlnnke~~F~~~t~e~se~~~s~d~~~e~~vg~~~r~~G~ss~~~l~~W~V~~LDd~~pfRq~~vS~~ 369 (2439)
T KOG1064|consen 295 ATD----PFVV-WLNNKELHFLTLTHENSEQDFSMDDEDEEIVGDGERLGGLSSGNPLNNWHVEWLDDYSPFRQPQVSFS 369 (2439)
T ss_pred ccC----ceeE-EEecccceeEEEeecCcccccccccccccccccccccccccCCCcccchhhhhccccCccccceeeec
Confidence 555 5666 999999999 444444556788888888899999999999999999999999999999999999999
Q ss_pred eeccccccCCCCCCCCCCcCccccceeEEe-----------ccccCCCCcccccccccccCcceeehhcccCCCCccccc
Q 000080 397 KKQNLELEHPHNSGFSGFQGQSLLNKVVIS-----------RDCVSGLPTICSLVHLSHCNSLVWSLLHAQRSGDVEDVS 465 (2389)
Q Consensus 397 ~r~~~~~~~~~~a~f~~~~da~~l~~~vi~-----------r~~~~g~p~~cs~~~l~~~N~~~~~~~h~~~sln~~~~s 465 (2389)
+|+|. +||+ +|+++|++.+.+ ++...-+..+|+++...+ |+++|+++|.||++| +++
T Consensus 370 srip~--------a~p~-~da~SLss~~~~~~~~~~~k~aiq~~~~~~~s~~ss~~Hs~-~tv~~is~H~ngsln--~~~ 437 (2439)
T KOG1064|consen 370 SRIPS--------AFPT-GDAMSLSSATMLNDCTPLYKDAIQPDNLYPGSILSSSYHSK-PTVMMISKHTNGSLN--SVS 437 (2439)
T ss_pred ccccc--------cccc-cchhhhhhhhcccCCcccchhhhccCCcCCCccccccccCC-CceEEEEeecccccc--cee
Confidence 99999 9999 999999999887 222223335788777777 999999999999999 889
Q ss_pred cCCCC-ccceeeecccceeeeccccceEeEEeeeccccchhhhhcc-CCC------ccEEEEEecccccccCCCCCCCCc
Q 000080 466 SDKSS-TGQILSCSASRILSIEGHTGKILQVAVHPCVSEFELAVSL-DSN------GLLLFWSLSTISNCISDLPTLMPS 537 (2389)
Q Consensus 466 ~~~~s-f~~i~s~~~s~~~~~~GH~~~i~qv~~Hp~l~~l~Lt~S~-d~~------~~LilW~vspv~~~~~~~~~~~P~ 537 (2389)
|++.+ |++++++ +|++|+|||||+|+||++||++ |++||+|+ +++ +|||+|+++|| ||
T Consensus 438 fs~~ssft~vls~--~h~~r~~GHrf~i~~la~hsvl-pllltTS~~~~~~~~~i~Se~ilwrv~~v----------gP- 503 (2439)
T KOG1064|consen 438 FSLKSSFTTVLSI--GHVSRFCGHRFHINDLACHSVL-PLLLTTSHHNSNDPIAICSELILWRVDPV----------GP- 503 (2439)
T ss_pred cccccchhheeee--eeEEEeecCCcchhhhccCCCc-cceeeecccccCCccceeeeeeEeeccCC----------cc-
Confidence 99988 9999999 9999999999999999999999 88888887 434 89999999999 99
Q ss_pred cccccc---ccccccc--CCccceeeeccccccceEEEEeecCCeeEEEEeccccCCCCeEeeeeEEEeccCCCCCCCCC
Q 000080 538 WKLCGK---LRTRKSC--SNYTSLRWAPSLLDEDMVLLMGHVGGIDCFIVKISQTEVDDIVCHYVCTIPFTGHGHYEDGP 612 (2389)
Q Consensus 538 l~~~Gg---lar~~s~--~~ftsl~W~Psil~~~~~~fva~~gg~d~~l~~i~~~~~enit~~~~c~i~l~~~~~~~~~~ 612 (2389)
+|+.|| ++|+++. ++|++|+|+|++||++|...+ |.|+.+||++.-++... +--|..|+|||+.......
T Consensus 504 ls~~ggVselar~Ns~~~s~fs~v~w~ptllps~~lg~~-~ns~sacFvA~dg~~~r--~yqavida~~ll~e~s~~e-- 578 (2439)
T KOG1064|consen 504 LSFNGGVSELARINSLHISAFSNVAWLPTLLPSYCLGTY-CNSPSACFVASDGGNLR--KYQAVIDAIPLLVELSLPE-- 578 (2439)
T ss_pred eeeccCcchhhhccchhhhhhceeeecccccccceeeee-ccCCcceeEEecCCcch--hhhhhhhcchhhhcCCchh--
Confidence 999999 9999998 999999999999999998777 88888888888776654 5778899999987644332
Q ss_pred ceeeeecCCccCCcccccceEEEEEEeecccceeEEEEEEeeecCCcccccCC-CCCCccccccCCcccccccceeeeee
Q 000080 613 ANIFSVPLPSCNDKTVMYNKFMLLGVWLKGLESLSWEITFHSFDLSESCCGCI-DDNNTVKCSMCKFETTFCGKKYFIGV 691 (2389)
Q Consensus 613 ~~ih~~p~~~~~~~tf~~n~f~lv~v~~~~f~~l~W~v~l~s~~~~~~~~~c~-~~~~~~~~~~~~~~~s~a~k~~~l~~ 691 (2389)
.++++-|.-.+|+++|+-+++.++-||+++|...+|+.+||.|+....+|+|+ -+.+......+-|+..|.++.++..+
T Consensus 579 ~S~~i~~~~n~vsqqsta~Pgcil~l~~i~~~~~~ns~~lhvFq~~~i~~~~~~~~~~~~~~~~~~Fee~F~~v~ie~~~ 658 (2439)
T KOG1064|consen 579 TSKFIGEVFNIVSQQSTARPGCILELDPIEKHNGSNSQLLHVFQEGFITADEHFMDSDSGGSPNPLFEEKFYGVIIEKKI 658 (2439)
T ss_pred HhhHhhhhhccccccccCCCcEEEeccccccccccchhhhhhhccCceeecccccccccccCCCccccccceeeeeeeec
Confidence 78888899999999999999999999999999999999999999999999999 77777777778899999999888888
Q ss_pred c----cccCcCCCCCCcccccEEEEeecCCCcCCCccccCCCCCCCCCCCeEEEEeecCCcEEEEEEEeCCCCCCceeee
Q 000080 692 N----PCSSQFPEPHTRNWVTSFAVVCPNNLVPMQQKLVYDNDPCSKIPPYTMATGYSDGSLRLWRSELGGSSTSCMPWE 767 (2389)
Q Consensus 692 ~----~cs~~~P~~~l~~~v~s~~~v~p~~~~~~~~~l~s~~~~~~~~~pYliaT~CSDG~VRfWkc~v~~~~~~~y~We 767 (2389)
+ +|+|++| +||+| +++++.|++ |||++++.||+ +||+|||+|+||+||||||++.++++....
T Consensus 659 d~ls~v~~q~l~---lpE~v-~i~~~~Psa-----ghlSssS~ypa--apYli~t~~sDg~vRfWrc~~~~d~~~~~s-- 725 (2439)
T KOG1064|consen 659 DSLSSVYTQELD---LPEGV-DIIVISPSA-----GHLSSSSNYPA--APYLIATICSDGLVRFWRCRVQGDDTAPNS-- 725 (2439)
T ss_pred cccceeccCCCC---cccce-eEEEecCcc-----ccccccccCcC--cceEEEEeccCCceeeeeeeeccCCCCccc--
Confidence 7 6778885 99999 899999998 99999999999 999999999999999999999876544332
Q ss_pred eeeeeecCCCCceEEEeecCCCeEEEEccCCC-CCCccEEEEEeeccccCcceeEeeceeccCC-----------ceEEE
Q 000080 768 LVGMLVAHQGPVSAISLTDGGRKIATVSAASH-SNAVSNVRIWESVCVTELGSFVLEDTLSFDT-----------NIVAV 835 (2389)
Q Consensus 768 ~w~ml~~~~G~p~~IS~a~tGR~a~a~~~~~~-~~~~s~vsIWD~~~~sgGGswvLE~ti~ld~-----------~IVdL 835 (2389)
||+|+.+ +|+|+|+||+||+|+++++ +....+|+|+|| ++++|+.|++|++|+++. |||||
T Consensus 726 ~W~l~~~------~Is~a~tgr~A~ay~~~~s~s~~~~~vai~ec-es~ggS~W~le~ti~~~~~~~e~~~~n~~~lv~L 798 (2439)
T KOG1064|consen 726 EWPLVSE------EISCAQTGRLACAYKKGSSTSIFALKVAIFEC-ESRGGSIWVLEQTIHSDEEHLESIFHNDKHLVDL 798 (2439)
T ss_pred hhHHHHh------hhhhcccCceeEEEecCCCcchheeEEEEEEe-cCccceEEEeehhhhhhhhhhhhhccccccceee
Confidence 6667666 8999999999999999887 567789999997 555555599999999863 89999
Q ss_pred EeEEccCCcEEEEEeecceEEEEEeccCCccccccccc--------------ccccccceeecc----CCCCC-cccccc
Q 000080 836 NWLTLENGQSLLGVCLQNELKVYAQRHYGGQILLDTKN--------------SLKMQNWFCLAF----SPTFA-AHDFTW 896 (2389)
Q Consensus 836 DWtStEDGqhILTVGfg~kVlLYtQlRydytn~~~~~~--------------ll~~~~w~~Id~----~~T~h-IgDssW 896 (2389)
|||||||||||||||||++|+||+|+|++|++...+.| ..-.+.|.++|. .+||| |+|++|
T Consensus 799 DW~Stedg~hILtVg~g~~v~lY~qlr~~~~~~t~~~~~~~s~~~P~~~~~~~~~~~~W~~lR~idl~~gtp~lp~~~sW 878 (2439)
T KOG1064|consen 799 DWTSTEDGQHILTVGFGSKVLLYGQLRQDYTNQTFAAMSSESQIRPLFRSTKSLSASSWVLLRSIDLLSGTPPLPVDLSW 878 (2439)
T ss_pred eeeecCCCcEEEEEeccceEEEEeecccchhhhhhhhhcchhhcccchhhhccccccceeeeeEEeeecCCCCCcccccc
Confidence 99999999999999999999999999999998652211 111237777763 59999 999999
Q ss_pred ccCceEEEEecCeeEEeeccchhhccccccccCCCccccccccccCCCCCCceeeecccccccCccC-CCCCcccCCCcc
Q 000080 897 GRRAIAIVVHQSYLSIYSQFLFLIDKKHQAKCNSNVFIDNFCCHKSGINENIVSTIFTVCDSESSAG-DQRGDYESAPSV 975 (2389)
Q Consensus 897 VRDGILVVGmgnEMhVYSQWl~~~~~k~q~~~~~~~~~~~~~~~~s~~~~~lv~~i~~~~ds~~~a~-~ql~~~~s~~~~ 975 (2389)
|||||||||||||||||+||++.... ..+........+ .++. +..+.+ .+.. .+......+
T Consensus 879 vrdGilVv~md~em~vy~qw~~~~~~------~~D~~l~s~~~d-----~s~~---~~~~~~-~~~~~~~~S~~~~~--- 940 (2439)
T KOG1064|consen 879 VRDGILVVAMDNEMHVYNQWKPSLVQ------GRDSSLLSTTND-----ISLL---DSTSTS-SGCLPSKKSRVLGD--- 940 (2439)
T ss_pred eecceEEEeecCcceehhcccccccc------ccCcccccCccc-----hHHH---Hhhccc-cccccCcccccccc---
Confidence 99999999999999999999983221 111111000000 1110 000000 0000 011111111
Q ss_pred cccccccccccccccccCCcc-ccccCHHHHHHHHcCCCCCcchHHHHHHHHcCCchhHHHHHHHHHHhccCCCCCcccc
Q 000080 976 NIDMKNDHLVASDQLKCGGAI-LGSWSMLEIAEKLRGSLPVYHPKALFLNIYSGNWKRAYVSVRHLVENLPSNYPSEKRY 1054 (2389)
Q Consensus 976 ~~~~~s~s~i~~~~~~~~~~~-~~~~~Lfe~~~~LnGpLPvYHPqfLiQ~L~~GK~~rVK~IL~~Lvk~L~~~~~~~~~~ 1054 (2389)
..+.+...++... +.+.. +.+.++||++++|+|+|||||||||+|+|++||++|||+||.||++||+....-.+.+
T Consensus 941 -~s~~~~~~~~~a~--~~~t~~~~~~glfe~a~vl~g~LPqYHP~qLl~ll~~gk~rrakAIL~hL~~cl~~~~~~~~~~ 1017 (2439)
T KOG1064|consen 941 -TSVANMSCIGTAY--GSPTVDIDDMGLFEAAHVLSGILPQYHPQQLLELLDAGKVRRAKAILLHLVLCLKGSVTVHKDL 1017 (2439)
T ss_pred -cchhhcccccccc--CCcccccccccHHHHHHhhCCCCcccCHHHHHHHHHcCcHHHHHHHHHHHHHHhcccccccccc
Confidence 1112222222211 33444 4789999999999999999999999999999999999999999999998832211111
Q ss_pred c----------------ccCCCCCCcccchhhhhcc-cccCCCCCCCccccCCCcccchhhhhhccccccccCCCCCCCc
Q 000080 1055 C----------------YTKSSHIVPQILLSTYFEG-LLSKGSTDNGFQWSGLNTFSTSLQFRQFAYNMDLDASNSSSST 1117 (2389)
Q Consensus 1055 ~----------------~~e~~~~~p~i~l~~~~~~-~~s~~~~~~~~~~~~~~~~~~~~~f~~~~~~~d~d~~~~~~~~ 1117 (2389)
+ +++++++ |+.|++.+.+. .++.+...++ ...|++.|+ +....+ ..+++
T Consensus 1018 ~~~st~~~~~d~~~~~~~~ei~Si-pplPl~~l~~ad~Ds~~~s~e~-------s~gyd~lF~-----~~~~~~-~~~e~ 1083 (2439)
T KOG1064|consen 1018 ASDSTSVLCQDELISKDTTEIDSL-PPLPLYALLAADRDSPYQSVEK-------SSGYDELFN-----DELSKT-ILLET 1083 (2439)
T ss_pred ccccccccchhhhccccchhhccC-CCCcHHHhhccccCCcceeccc-------ccccchhhh-----cccccc-ccccc
Confidence 1 1355544 55555444432 2211111000 011344552 222222 22456
Q ss_pred hhhhhHHHHhhhccccccCCCHHHHHHHHHHHHHHHHhhccccccccccCCccccchhhHHHHHHHHHhhhcCccccccc
Q 000080 1118 KSELSGFVELLQNVYELAGVTDAEKMEILAVVDLLNEFDNKHSASVYENLDEPGQRFWVELRFQLLCFFRRFGKLVSAEE 1197 (2389)
Q Consensus 1118 ~~~~s~l~E~L~k~~sLPgLT~~EQm~Llalidtv~~i~k~~~~~~~~sLDenGlRFLl~~k~~ql~~lr~~~~~~~~~~ 1197 (2389)
+++.+-|++.|.++++||||||+|||+|+||||||+++...++. ++|||||+|||++||+++++..+..++.++.+.
T Consensus 1084 d~~~s~FLt~lLths~lpgLSR~eQm~LlAlaDtv~~~st~~~~---~tLDecGlRfllamr~~~~ll~~lp~~raql~~ 1160 (2439)
T KOG1064|consen 1084 DEEFSYFLTELLTHSSLPGLSRLEQMHLLALADTVAETSTDHSE---ETLDECGLRFLLALRLHTLLLTSLPGYRAQLLH 1160 (2439)
T ss_pred hhhhhHHHHHHHhhccCCCccHHHHHHHHHHHHHHHHhcccccc---ccccccchhHHHHHHHHHHHHhhchhhhhhhhh
Confidence 67777888777777899999999999999999999999877543 679999999999999987655444444556666
Q ss_pred cccccccchhhhcccCHHHHHhhc---CCCCCCHHHHHHcCcEEEEeChHHHHHHHHHHHHHHHhccCCcchhHHHHHHh
Q 000080 1198 LAVDSRLIAWAFHSECQETLFGSI---LPNEPTWPEMRALGVGFWYTDVTQLRTRMEKLARLQYLKKKDPKDCALLYIAL 1274 (2389)
Q Consensus 1198 ~~Ls~r~i~WA~HSesqe~LL~~v---~~~~~sW~~~r~~Gv~~Wl~~~~~Lr~~~EkIAr~ey~~~kDP~dcaLfYlAL 1274 (2389)
.+|++++|+||||||+||+||+.+ .+++++|++||++|||||++|..+||++||||||++|+++|||+|||||||||
T Consensus 1161 ~gl~ts~iaWAFHSe~eEeLlNl~psl~r~~~sW~elR~~gig~WlkN~~~Lr~ciEKlAK~af~kn~dP~DaALfYLAL 1240 (2439)
T KOG1064|consen 1161 QGLSTSHIAWAFHSENEEELLNLLPSLHRGDPSWNELREYGIGWWLKNEQTLRKCIEKLAKAAFQKKRDPLDAALFYLAL 1240 (2439)
T ss_pred cCCchhheeeecccccHHHHHhhcccccCCCccHHHHHhhCchhhhccHHHHHHHHHHHHHHHHHhcCChhhhhHHHHHH
Confidence 799999999999999999999854 57899999999999999999999999999999999999999999999999999
Q ss_pred cchHHHHHHHhcccCCCchhHHhHhhcccChHHHHHHHHhhHHHHhhcchhHHHHHHHHhcCChhHHHHHHHHhcCChhh
Q 000080 1275 NRIQVLAGLFKISKDEKDKPLVGFLSRNFQEEKNKAAALKNAYVLLGRHQLELAIAFFLLGGDAASAVTVCARNLGDVQL 1354 (2389)
Q Consensus 1275 ~Kk~vL~gL~k~~~~~k~~~m~~FLsnDFse~RWr~AAlKNAyaLLsK~Ry~~AAAFFLLAg~lkDAV~Vc~~~L~D~qL 1354 (2389)
|||+||+||||++++||+++|++||+|||++||||+||+||||+||||||||+|||||||||+++|||+||++||+|+||
T Consensus 1241 kKk~Vl~gLfr~~~~hed~kmv~FfsnnF~eerWrkAAlKNAFvLLgKhRfe~AaaFFLLagslkDAI~VC~kkl~DiQL 1320 (2439)
T KOG1064|consen 1241 KKKQVLWGLFRLAKDHEDTKMVVFFSNNFTEERWRKAALKNAFVLLGKHRFEHAAAFFLLAGSLKDAINVCCKKLNDIQL 1320 (2439)
T ss_pred HHHHHHHHHHHHhhccccchHHHHhhccccHHHHHHHHHhhHHHHhhhHHHHHHHHHHhhcchHHHHHHHHHHhhhhhhh
Confidence 99999999999999999999999999999999999999999999999999999999999999999999999999999999
Q ss_pred hhhhhhhhccCCChhhHhhHhhhccccccccCChhHHHHHHHHhCChhHHHHHHhcCccccccccccccCCCccC-----
Q 000080 1355 ALVICRLVEKHGGPLERNLVTKFILPSSIERGDYWLTSLLEWELGNYSQSFLTMLGFQSTAVINNFALSSNSVAF----- 1429 (2389)
Q Consensus 1355 Ai~IaRLyEgd~gp~l~~lL~~~vLp~a~~~gDrwL~S~a~W~L~~~~~Av~~Ll~~p~~~~~~~s~l~s~~~~f----- 1429 (2389)
||+||||||||+||++++||+++|||.+++++||||+||+||+||+|.+|++||++.++.+......-.+++..|
T Consensus 1321 ALvI~RlYEgd~g~~~~~LL~~~vLp~~v~~~DpwLrSmayWiLkdy~rAl~tLl~~~~~end~~~~s~~~~~Vf~ny~y 1400 (2439)
T KOG1064|consen 1321 ALVICRLYEGDGGPTYKELLNKYVLPIAVQHNDPWLRSMAYWILKDYTRALLTLLGQLPRENDALYTSASNPEVFNNYSY 1400 (2439)
T ss_pred hheeeeeecCCCchHHHHHHHHhhcccccccCCHHHHHHHHHHHHHHHHHHHHHhcCccccChhhhhcccCcchhhchhh
Confidence 999999999999999999999999999999999999999999999999999999987433222110002222222
Q ss_pred -CChHHHHHHHHh-hccccchhhhccch----hhhhHHHHHHHHHHHHHhcCCChhhhhcccCCCCCCCCCCccccccCC
Q 000080 1430 -MDPSIGLYCLML-ANKNSMRNAIGEKN----AAILGRWAALMRATALNRCGLPLEALDCLSSSPSTIGGTDQESVLNIG 1503 (2389)
Q Consensus 1430 -~DPaL~l~~~~L-~sk~~~r~~~g~~~----~~~~~r~~~l~~a~~l~RmGC~lLALdll~~s~~~~~~~~~~s~~~~~ 1503 (2389)
-+|-+++|+... +.+..++++.|..+ +...|||+|+++|++|+|||||+||||+|++......++.+.+++...
T Consensus 1401 lr~hplllr~~~~~~~~~~~~~~L~~~~~e~~~~~iErrl~l~tA~ah~r~GCpllALevLs~~p~~~~~s~d~s~~~~~ 1480 (2439)
T KOG1064|consen 1401 LRTHPLLLRRNLASAEKFSLKYALGGRSLEDIINLIERRLFLTTANAHCRCGCPLLALEVLSKWPKVIKGSKDTSEASKL 1480 (2439)
T ss_pred hccCcHHHhhhhccccchhHHHHhhccchhhcccchheeeeeehhhHHHhcCCcHHHHHhhhcccccccCCcccchhhcc
Confidence 266666677776 66777888888777 457899999999999999999999999999999999999998988777
Q ss_pred Ccccccc----cccCCCCCCCccccccccccccccccccccHHHHHHHHhhcCCCCCccCcCCCCccccchhhhhHHHHH
Q 000080 1504 HSHILPE----ILKPSAATGSSNWLLRDVALHLESCAKLDLSLQYFSKLIRDHPSWPDLGFGRASKCFMDFEIHQYEKLV 1579 (2389)
Q Consensus 1504 ~~~~~~~----~~~~~~~~~~~nw~~~~~~~~~~~~~~~~~~~~~~s~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 1579 (2389)
+-+--++ ...+..+ +|.+|....|....+++...+.+.+..+..-+|-..+. ++-++.+++| .
T Consensus 1481 ~~~d~q~~a~~~~~~~t~-~s~dw~~p~vs~~~d~~~~~w~~e~~ee~~~~e~~~~~-----------~~~p~~~~~k-~ 1547 (2439)
T KOG1064|consen 1481 QLDDRQSGASGEADSSTP-ISFDWSQPSVSDQDDSLELDWDEEQNEEEIDREADEPL-----------LNPPVRQCDK-F 1547 (2439)
T ss_pred ccccccccccCCCccCCc-ccccccCCcccCCCCCcccCccccccchhhcccccccc-----------cCCcccccch-h
Confidence 7666666 6777766 99999999999999999999999999888877775444 7778889988 7
Q ss_pred HHHHHHHHHHHHHHhhhcccChHHHHHHHHHhhccCCeeeeeeehhcccccCCCccccccCccCCcccccccchhhhhhh
Q 000080 1580 QNFQQKLYTALAFFEQRFSMDSSSLIAKILSLLCNNGLLFIGYDLLHGYICQGKSQEKSSDTVDGLSLYFCQHKPLLKAA 1659 (2389)
Q Consensus 1580 ~~~~~~~~~~~~~f~~~f~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 1659 (2389)
-+++.|+.|+ ..|.|+|.+++...|.|..+.-.+.|....|..|...........+| ........+|....|.. |+.
T Consensus 1548 ~~~~s~~~t~-di~aq~~kfvA~l~ilm~eLsTlatG~e~dGg~lr~ql~nwlerev~-al~~~cd~~s~ak~~~~-~~~ 1624 (2439)
T KOG1064|consen 1548 LRQKSKNDTE-DIFAQQLKFVACLKILMEELSTLATGYESDGGKLRYQLYNWLEREVK-ALKDTCDYCSSAKSKSS-KSG 1624 (2439)
T ss_pred hhhhhcCChH-HHHHHHHHHHHHHHHHHHHHhcccccccccchhHHHHhhhhhhhhHH-HHHhHHhhhhhhhcccc-ccc
Confidence 7888899999 99999999999999999999999999999999999888888877888 66666667888888877 999
Q ss_pred hhHHHHHHhhhheeeeecccCCcCCccccccccccccccccccchHHHHHHHHHHHHHHHHhhcCCCcccccchh-hhhH
Q 000080 1660 EDISIFLSRFIAATSITCSHLKSTNSENVRHHEVRSRWSNAQGYYFQSIIFSLWSLRAAMRTFSGSFPEELITPL-FLLD 1738 (2389)
Q Consensus 1660 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~r~~~~~~~~~~~~~~-~~~d 1738 (2389)
++.+++++|. .+|..+ |..+++++|.++.+++++|++|.++||||++...+..+|..|.+.|...|++.... +..|
T Consensus 1625 ~~~s~~~~~~-~a~~~p--h~~~~~~~~~~~~~~r~~Wl~a~q~llr~~ls~cslh~a~~~~lasv~mEll~ll~~~q~e 1701 (2439)
T KOG1064|consen 1625 DEKSLLLDRE-AACDVP--HQIKCFRLQRESAGKRKKWLKANQFLLRGFLSYCSLHGASGGGLASVRMELLLLLQEVQQE 1701 (2439)
T ss_pred chhhhhhccc-ccccCC--chhhhhhhchhhcccchHHHHHHHHHHHHHHHHHhhccccCCcchhhhHHHHHHHHHHHHH
Confidence 9999999999 999999 99999999999999999999999999999999999999999999999999999988 9999
Q ss_pred HHHHHHHHHHHHhhcccccceeeeecEEEEeecCCcceeechHhHHHHHHHhhhhhccccccccccccceeeeecccccc
Q 000080 1739 LYEYYVHFASAWLQRDSKGLLQVLQPVLITYTNGHTPYEVDMNNLKTFFHQSAELLTRNTSIDNMVGDLQVSKFVDDERS 1818 (2389)
Q Consensus 1739 l~e~~~~~~~~w~~~~~~~~~~~~~p~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 1818 (2389)
+.||++.-+++|- .+...|..|++|..+.+.|+|+|||++...+++++||.+. .+++++.+++++.+.+-+++....
T Consensus 1702 ~~~~~l~~~l~~~-~t~plL~a~va~~k~~vanp~~~le~~~~dil~~i~q~~~--~p~p~~~~~~v~~l~sl~~~~s~~ 1778 (2439)
T KOG1064|consen 1702 TTEYQLSSPLPWP-TTVPLLFACVAPLKTVVANPLLYLENQTHDILRAIIQEAS--VPHPDASDVKVYVLHSLAVSLSAC 1778 (2439)
T ss_pred hHHHHHhcccCCC-cchhHHHHhhcCceEEEecCceehhhhHHHHHHHHHhccC--CCCCChhhcceeeehhhHhhhcce
Confidence 9999999999999 9999999999999999999999999999999999999999 889999999999999999999999
Q ss_pred ccccCCCCccccceeehhhHHHHHHHHHHhhhhccccccccccccccccCccccccccCCCCCccchhhHHHHHHHHHHH
Q 000080 1819 TDLMNSIPEDERWQIMGACLWQHMSRFMKHKLNSMSVKLDENHSSRLLGGHISSWTSSLTNPESASIGLKEQMRLLTLFL 1898 (2389)
Q Consensus 1819 ~~~~~~~~~~e~~~~~~~~~w~~~s~~~~~~l~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 1898 (2389)
.+..++.|+++ +.|... .|++.|.|.++...+++.++ .....|.|..+++ ....|.++..+..-+..+ +|.
T Consensus 1779 iY~~l~~~~~~-~ll~~r---~~~~~~s~~~~~t~~~~p~~---wpgvs~l~~ll~~-~~~~d~~~l~vll~E~~~-av~ 1849 (2439)
T KOG1064|consen 1779 IYQSLCDSESY-CLLTQR---PRLRTGSKDELVTPNTSPAQ---WPGVSGLIALLDS-EKEEDQSKLNVLLCESFV-AVY 1849 (2439)
T ss_pred eeeeecccccc-ccccCC---CccccccccccccccCCccc---ccchHHHHHHhhh-ccccccCcceEeehHHHH-HHH
Confidence 99999999999 444444 89999999999999999998 5667788999988 889999999999999755 699
Q ss_pred HHHHHHHHHHHhhHHHHHHHHHHHHHhhcCCCCchhhhhhhhCCCCcchhhhhhhhhhhcccccccccchhHHHHHHhhc
Q 000080 1899 AQLLKSALLHISSHHVKQLAFFLRYKVENGFDIPTRRWLQEATPSQSGTLYQHLNQIVVSMNIINNKDEAAISELLWDVC 1978 (2389)
Q Consensus 1899 ~~~~~~~~~~~ss~~~k~~~~~~~~~~~~~~~~~~~~w~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 1978 (2389)
+++++.+|...||||+++++....++.+.++..++..|| +|+ +|+.++..+++ ++.+.+.+++..++. --.+|
T Consensus 1850 ~slfi~~Lat~sS~~l~rl~~~~~n~~~~~~~fggg~~l-~~k-~~a~~~~~~ap----~~~e~t~~n~~~~~t-~~~~~ 1922 (2439)
T KOG1064|consen 1850 LSLFIHALATLSSRELFRLVAHPLNNLMWSLVFGGGLKL-ECK-PQAQSLNRDAP----SLSEETKENESKVST-PSKVS 1922 (2439)
T ss_pred HHHHHHHHHhccHHHHHHHhccccChhheeeeecCceee-eec-CcccCCCCCCC----cccccccccCCCCCC-CCCCC
Confidence 999999999999999999999999999999999999995 444 89999999998 555555555544444 22999
Q ss_pred CCCccccccccccccccccccccccCcchhhhhhcceeeeccccccccccccCcccccCcccccccccccCCCCCCCccc
Q 000080 1979 SDPSIIHEGFTQEKLNWRSYINCKLSKGWSHINEGVKLKHEIKKTCKNEDKLGSTLASGEVGSASKDLFRNSRTSPRSWH 2058 (2389)
Q Consensus 1979 ~~p~~~~~~f~~e~~~~~~~~~~~~~~~w~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 2058 (2389)
+||..++|.|+.|+++.++|+..||.+.|.|+++++....|.++ ++.+ .+++++..++..+.... ||
T Consensus 1923 ~~~~~~~ekfippe~~i~~~f~~KP~~~~~D~d~s~~sdne~~~-~~~D-----~~~s~~~l~e~~~~~s~------sw- 1989 (2439)
T KOG1064|consen 1923 VDSPALHEKFIPPELSIWDYFKAKPSEDWYDSDESVESDNEDYV-DDDD-----VRSSDEQLSEHNNPNSY------SW- 1989 (2439)
T ss_pred CCchhhhhhcCCccccHHHHHhcCcccccccchhhhcccchhcc-cccc-----ccccHHHHHhhcCCccc------cH-
Confidence 99999999999999999999999999999999999999999999 8886 56666666654444322 22
Q ss_pred ccccccccccCCCCchhhhhcccceeeeeecccCCCcceEEeecccceEEeeecccccccccccceeccCCCCCCCCCCC
Q 000080 2059 KDANMANEVIPFQAPKEICKRNGELFEALCVNSIDQRQGAIASNRKGIVFFNLEDEIPLHDQLKYIWADADWPQNGWAGS 2138 (2389)
Q Consensus 2059 ~~~~~~~~~~~f~~~~~~~~~~~~~~~a~~~n~~n~~~~~~a~~~k~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 2138 (2389)
+....+.++..|+|+||+|||-|+.++++|+|.||..|+.+++| ++++++|..+..+-..+.+|+|..|+|++++|+-.
T Consensus 1990 ~ll~la~~~~~~hn~k~~~~~aG~~~spl~~n~i~~~~a~~~~~-g~ai~~~~~l~~~~ntpf~s~~s~a~~~~rlW~~l 2068 (2439)
T KOG1064|consen 1990 SLLRLAMVQLALHNVKEFHKRAGEDISPLCRNYINHRQAELSSN-GPAILRNKALLEPSNTPFKSIDSSADSVKRLWAYL 2068 (2439)
T ss_pred HHHHHHHHHHHhhhhHhhhhhhcccccccccccccccchhhhcC-CcceeehHhhcCccCCcccccccccccHHHHHHHH
Confidence 23458889999999999999999999999999999999999999 99999999999999999999999999999999999
Q ss_pred cccccCCccCCCccccCCCCcccccCCcccccccccCCCccccCcccccc------------------------------
Q 000080 2139 ESTPVPTFVSPGVGLGSNKGAHLGLGGATIGVGSLARPGRDLTGGLAFGI------------------------------ 2188 (2389)
Q Consensus 2139 ~s~p~~~~~s~~~g~~~~~g~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~------------------------------ 2188 (2389)
|+++++++|.-++|++.+++.|+++|+..-+ .+.+|+.--=.||+.
T Consensus 2069 v~q~~~qevfik~if~k~~~~e~~lG~~g~~----~~iike~e~ivaf~~n~~s~~~ia~an~~~~qe~dvs~~~~~q~~ 2144 (2439)
T KOG1064|consen 2069 VKQEVLQEVFIKYIFTKKKEIEADLGYSGGK----ARIIKESEEIVAFPVNKESVNTIAFANHHDVQEFDVSSSLAHQYY 2144 (2439)
T ss_pred hcccccceeeeeehhccCCccccccCcCCCc----eeEeecccceeccCcCcCCcceEEecCCCcchheeccchhhhhhh
Confidence 9999999999999999999999999865211 233333211112221
Q ss_pred -----------ccccccceeecc---ccccccc----cccccC------------------CCCcCceeEEEEEEcCCCC
Q 000080 2189 -----------PGYAGIGASALG---WETQDDF----EDYVDP------------------PATVENISTRAFSSHPLRP 2232 (2389)
Q Consensus 2189 -----------~g~~~~~Asg~~---~d~~~~~----~~~~d~------------------~atv~ni~VrsVAFsPdG~ 2232 (2389)
-| .+-.|.+.. ...+... ..|.+. ...++ .|+++.-||.-+
T Consensus 2145 ~w~~ne~d~~~~~-~d~~~~~s~~~~l~~~~~~~~~s~~~~~~n~~~~~~tq~~~~~~~~~k~~v~--~v~r~~sHp~~~ 2221 (2439)
T KOG1064|consen 2145 WWFGNERDTETKG-VDPDANHSPPDALASQSTVGSFSNRFTPSNLPWLGSTQTSRGASVMIKHPVE--NVRRMTSHPSDP 2221 (2439)
T ss_pred hhhcchhhhhhcC-CCcccccCchhhcccccccccccccCCcccCCccccceecccceeEeecccC--ceeeecCCCCCc
Confidence 11 111111111 1112222 111110 11233 459999999999
Q ss_pred eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccce
Q 000080 2233 FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPME 2312 (2389)
Q Consensus 2233 ~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~ 2312 (2389)
+.+|||+||.||+|+++.|+.+.+++. +|. +.|+.+.|+.+|+.++.+..||.+.+|++.- +++.
T Consensus 2222 ~Yltgs~dgsv~~~~w~~~~~v~~~rt--------~g~-s~vtr~~f~~qGnk~~i~d~dg~l~l~q~~p------k~~~ 2286 (2439)
T KOG1064|consen 2222 YYLTGSQDGSVRMFEWGHGQQVVCFRT--------AGN-SRVTRSRFNHQGNKFGIVDGDGDLSLWQASP------KPYT 2286 (2439)
T ss_pred eEEecCCCceEEEEeccCCCeEEEeec--------cCc-chhhhhhhcccCCceeeeccCCceeecccCC------ccee
Confidence 999999999999999999999999873 345 8899999999999999999999999999972 7999
Q ss_pred eeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcccc
Q 000080 2313 SCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSKCR 2386 (2389)
Q Consensus 2313 tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~~~ 2386 (2389)
+.+||+....+++|.. +++||+|.++++++|.+||++.++...+-. .||.++++++++-|+-.-.+|--|
T Consensus 2287 s~qchnk~~~Df~Fi~---s~~~tag~s~d~~n~~lwDtl~~~~~s~v~-~~H~~gaT~l~~~P~~qllisggr 2356 (2439)
T KOG1064|consen 2287 SWQCHNKALSDFRFIG---SLLATAGRSSDNRNVCLWDTLLPPMNSLVH-TCHDGGATVLAYAPKHQLLISGGR 2356 (2439)
T ss_pred ccccCCccccceeeee---hhhhccccCCCCCcccchhcccCcccceee-eecCCCceEEEEcCcceEEEecCC
Confidence 9999999999999996 899999999999999999999888877433 999999999999888766666443
No 2
>PF12234 Rav1p_C: RAVE protein 1 C terminal; InterPro: IPR022033 This domain family is found in eukaryotes, and is typically between 621 and 644 amino acids in length. This family is the C-terminal region of the protein RAVE (regulator of the ATPase of vacuolar and endosomal membranes). Rav1p is involved in regulating the glucose dependent assembly and disassembly of vacuolar ATPase V1 and V0 subunits.
Probab=100.00 E-value=1.3e-141 Score=1320.97 Aligned_cols=618 Identities=32% Similarity=0.526 Sum_probs=526.1
Q ss_pred CcEEEEEEEeCCCCCCceeeeeeeeeecCCCCceEEEeecCCCeEEEEccCCCCCCccEEEEEeeccccCcceeEeecee
Q 000080 747 GSLRLWRSELGGSSTSCMPWELVGMLVAHQGPVSAISLTDGGRKIATVSAASHSNAVSNVRIWESVCVTELGSFVLEDTL 826 (2389)
Q Consensus 747 G~VRfWkc~v~~~~~~~y~We~w~ml~~~~G~p~~IS~a~tGR~a~a~~~~~~~~~~s~vsIWD~~~~sgGGswvLE~ti 826 (2389)
|+||+|+++|+.+. ..+.|.++..+.++..+|..|+||.+| |+|++++ .+++|+|||+ .+| +||+++
T Consensus 1 g~~~~~~a~v~~~~-~~~~w~~t~~~~T~i~~~~li~gss~~-k~a~V~~-----~~~~LtIWD~----~~~--~lE~~~ 67 (631)
T PF12234_consen 1 GRIRTWTARVDTES-NKIEWLLTSTFETGISNPSLISGSSIK-KIAVVDS-----SRSELTIWDT----RSG--VLEYEE 67 (631)
T ss_pred CeeEEEEEEEcCCC-CeEEEEEEEEEecCCCCcceEeecccC-cEEEEEC-----CCCEEEEEEc----CCc--EEEEee
Confidence 78999999998775 589999999999999999999999998 6788865 5889999997 455 577777
Q ss_pred cc--CCceEEEEeEEccCCcEEEEEeecceEEEEEeccCCcccccccccccccccceeeccCCCCC-ccccccccCceEE
Q 000080 827 SF--DTNIVAVNWLTLENGQSLLGVCLQNELKVYAQRHYGGQILLDTKNSLKMQNWFCLAFSPTFA-AHDFTWGRRAIAI 903 (2389)
Q Consensus 827 ~l--d~~IVdLDWtStEDGqhILTVGfg~kVlLYtQlRydytn~~~~~~ll~~~~w~~Id~~~T~h-IgDssWVRDGILV 903 (2389)
.| ++.|+||||||+||||+||+|||+++|+||+|+||||++..|.+...++.+ | .++||| |||++|++||+||
T Consensus 68 ~f~~~~~I~dLDWtst~d~qsiLaVGf~~~v~l~~Q~R~dy~~~~p~w~~i~~i~---i-~~~T~h~Igds~Wl~~G~Lv 143 (631)
T PF12234_consen 68 SFSEDDPIRDLDWTSTPDGQSILAVGFPHHVLLYTQLRYDYTNKGPSWAPIRKID---I-SSHTPHPIGDSIWLKDGTLV 143 (631)
T ss_pred eecCCCceeeceeeecCCCCEEEEEEcCcEEEEEEccchhhhcCCcccceeEEEE---e-ecCCCCCccceeEecCCeEE
Confidence 77 789999999999999999999999999999999999888755554444311 1 369999 9999999999999
Q ss_pred EEecCeeEEeeccchhhccccccccCCCccccccccccCCCCCCceeeecccccccCccCCCCCcccCCCcccccccccc
Q 000080 904 VVHQSYLSIYSQFLFLIDKKHQAKCNSNVFIDNFCCHKSGINENIVSTIFTVCDSESSAGDQRGDYESAPSVNIDMKNDH 983 (2389)
Q Consensus 904 VGmgnEMhVYSQWl~~~~~k~q~~~~~~~~~~~~~~~~s~~~~~lv~~i~~~~ds~~~a~~ql~~~~s~~~~~~~~~s~s 983 (2389)
||+||||+||.+|.. . ...+.
T Consensus 144 V~sGNqlfv~dk~~~-~------------------------~~~l~---------------------------------- 164 (631)
T PF12234_consen 144 VGSGNQLFVFDKWLD-T------------------------SQSLG---------------------------------- 164 (631)
T ss_pred EEeCCEEEEECCCcC-c------------------------hhhcc----------------------------------
Confidence 999999999999985 0 01110
Q ss_pred cccccccccCCccccccCHHHHHHHHcCCCCCcchHHHHHHHHcCCchhHHHHHHHHHHhccCCCCCcccccccCCCCCC
Q 000080 984 LVASDQLKCGGAILGSWSMLEIAEKLRGSLPVYHPKALFLNIYSGNWKRAYVSVRHLVENLPSNYPSEKRYCYTKSSHIV 1063 (2389)
Q Consensus 984 ~i~~~~~~~~~~~~~~~~Lfe~~~~LnGpLPvYHPqfLiQ~L~~GK~~rVK~IL~~Lvk~L~~~~~~~~~~~~~e~~~~~ 1063 (2389)
+......+||||+|++||||||+||||||+|||++||+++|++||.||+++|+.....+ ... . +..
T Consensus 165 ---------~~~~~~~~dl~~~v~~LngpLPvYHPqfL~q~l~~Gk~~lv~~IL~~L~~~L~~~~~~~--i~~--~-~~~ 230 (631)
T PF12234_consen 165 ---------SRKILPNWDLFELVSRLNGPLPVYHPQFLIQLLLSGKFKLVKKILLHLFKCLRFLDEGE--ISD--L-DSF 230 (631)
T ss_pred ---------ccccCccCCHHHHHHHhCCCCCCcCHHHHHHHHHcCCHHHHHHHHHHHHHHHHhhcccc--ccc--c-ccc
Confidence 00111227899999999999999999999999999999999999999999999865321 111 1 124
Q ss_pred cccchhhhhcccccCCCCCCCccccCCCcccchhhhhhccccccccCCCCCCCchhhhhHHHHhhhccccccCCCHHHHH
Q 000080 1064 PQILLSTYFEGLLSKGSTDNGFQWSGLNTFSTSLQFRQFAYNMDLDASNSSSSTKSELSGFVELLQNVYELAGVTDAEKM 1143 (2389)
Q Consensus 1064 p~i~l~~~~~~~~s~~~~~~~~~~~~~~~~~~~~~f~~~~~~~d~d~~~~~~~~~~~~s~l~E~L~k~~sLPgLT~~EQm 1143 (2389)
+.+++++|+....+.....+.. ..+...+. ..+.+..++++.++.++|.|+++ +||+||+|||+
T Consensus 231 l~i~~~~~~~~~~~~~~~~~~~-----------~~~~~~~~----~~~~~~~f~~~~a~~L~e~L~~~-~LP~Lt~~EQ~ 294 (631)
T PF12234_consen 231 LGIPLEKFYESDESDSSVDKTE-----------SSSDQKDL----SDEEFSKFNEELADSLSEKLTKI-SLPGLTRHEQM 294 (631)
T ss_pred cCCcHHHHhccCcccccccccc-----------cccccccc----cccCccccCHHHHHHHHHHhhcC-CccCCCHHHHH
Confidence 6788888886543221110000 00000111 12223356788999999999998 99999999999
Q ss_pred HHHHHHHHHHHhhccccccccccCCccccchhhHHHHHHHHHhhhcCccccccccccccccchhhhcccCHHHHHhhcCC
Q 000080 1144 EILAVVDLLNEFDNKHSASVYENLDEPGQRFWVELRFQLLCFFRRFGKLVSAEELAVDSRLIAWAFHSECQETLFGSILP 1223 (2389)
Q Consensus 1144 ~Llalidtv~~i~k~~~~~~~~sLDenGlRFLl~~k~~ql~~lr~~~~~~~~~~~~Ls~r~i~WA~HSesqe~LL~~v~~ 1223 (2389)
+|++||||+++++++ +++||+||+|||+++|++++ .++. .++.+|++|+|+||+||++||+|++.+.+
T Consensus 295 ~L~~iie~v~~v~~~-----~~~lD~~g~Rfll~~r~~~~--~~~~-----~~~~~l~~~~i~WA~hS~~qe~Ll~~~~~ 362 (631)
T PF12234_consen 295 TLLAIIETVAEVEKN-----RRSLDENGLRFLLSVRLHQL--HRKS-----LEQSSLSTRDIAWAFHSDSQEELLSLVPP 362 (631)
T ss_pred HHHHHHHHHHHhhhc-----ccCCChhHHHHHHHHHHHHh--hccc-----ccccCcCHHHHHHHHhccCHHHHHHHhhh
Confidence 999999999999976 68999999999999998653 2221 34458999999999999999999998865
Q ss_pred CC-CCHHHHHHcCcEEEEeChHHHHHHHHHHHHHHHhc--cCCcchhHHHHHHhcchHHHHHHHhcccCCC-chhHHhHh
Q 000080 1224 NE-PTWPEMRALGVGFWYTDVTQLRTRMEKLARLQYLK--KKDPKDCALLYIALNRIQVLAGLFKISKDEK-DKPLVGFL 1299 (2389)
Q Consensus 1224 ~~-~sW~~~r~~Gv~~Wl~~~~~Lr~~~EkIAr~ey~~--~kDP~dcaLfYlAL~Kk~vL~gL~k~~~~~k-~~~m~~FL 1299 (2389)
.. ++|+++|++||+||+++.+.||+++|+|||++|++ +|||++|||||+|||||+||+||||++.+++ +++|.+||
T Consensus 363 ~~~~~W~~~r~~gv~~W~~~~~~Lr~~~E~iAr~~~~~~~~~dp~~~al~YlAl~Kk~vL~~L~k~a~~~~~~~k~~~Fl 442 (631)
T PF12234_consen 363 QIKLSWEEARELGVGFWLRSIESLRSQFEKIARNEFQKNDTKDPSDCALFYLALGKKKVLAGLWKMASWHKEQQKMAKFL 442 (631)
T ss_pred hccCCHHHHHhhCCEEeecCHHHHHHHHHHHHHHHHhhccCCCHHHHHHHHHHhccHHHHHHHHHhhhcccccHHHHHHH
Confidence 43 79999999999999999999999999999999998 5999999999999999999999999988764 68999999
Q ss_pred hcccChHHHHHHHHhhHHHHhhcchhHHHHHHHHhcCChhHHHHHHHHhcCChhhhhhhhhhhccCCChhhHhhHhhhcc
Q 000080 1300 SRNFQEEKNKAAALKNAYVLLGRHQLELAIAFFLLGGDAASAVTVCARNLGDVQLALVICRLVEKHGGPLERNLVTKFIL 1379 (2389)
Q Consensus 1300 snDFse~RWr~AAlKNAyaLLsK~Ry~~AAAFFLLAg~lkDAV~Vc~~~L~D~qLAi~IaRLyEgd~gp~l~~lL~~~vL 1379 (2389)
+|||+|||||+||+||||||||||||++|||||||||+++|||+||++||+|+||||+||||||||+||+++++|+++||
T Consensus 443 ~ndF~~~rwr~AAlKNAyaLlsk~Ry~~AAaFFLLag~l~dAv~V~~~~l~D~qLAi~i~Rl~e~d~gp~~~~ll~~~vL 522 (631)
T PF12234_consen 443 SNDFTEPRWRTAALKNAYALLSKHRYEYAAAFFLLAGSLKDAVNVCLRQLNDPQLAIAIARLYEGDNGPVLKKLLEEHVL 522 (631)
T ss_pred hhcCCChHHHHHHHHhHHHHHhcccHHHHHHHHHhcccHHHHHHHHHHHccChhHHHHHHHHHcCCCchHHHHHHHHhhh
Confidence 99999999999999999999999999999999999999999999999999999999999999999999999999999999
Q ss_pred ccccccCChhHHHHHHHHhCChhHHHHHHhcCccccccccccc-----cCCCccCCChHHHHHHHHhhccccchhhhccc
Q 000080 1380 PSSIERGDYWLTSLLEWELGNYSQSFLTMLGFQSTAVINNFAL-----SSNSVAFMDPSIGLYCLMLANKNSMRNAIGEK 1454 (2389)
Q Consensus 1380 p~a~~~gDrwL~S~a~W~L~~~~~Av~~Ll~~p~~~~~~~s~l-----~s~~~~f~DPaL~l~~~~L~sk~~~r~~~g~~ 1454 (2389)
|.|.++|||||+||+||+||||++|+++|++.+...+.+.+.. .++++..+||+|+++|++||+|+ +++++|..
T Consensus 523 p~a~~~~d~wl~s~~~W~L~~~~~ai~~Li~~~~~~~~~~~~~~~~~~~~~sfl~~dp~L~~ly~~Lr~k~-~~~~~g~~ 601 (631)
T PF12234_consen 523 PEAIKEGDRWLASWAFWMLGDYDEAIRALISPPIDLLNESPLSPSSPCNSKSFLVDDPALVVLYQQLRSKN-LQTLKGAS 601 (631)
T ss_pred ccccccCCHHHHHHHHHhcCCHHHHHHHHhcCccccccccccccccccccccccCCCcHHHHHHHHHHHhc-ccccchhc
Confidence 9999999999999999999999999999998887765443322 23355567999999999999996 99999999
Q ss_pred hhhhhHHHHHHHHHHH-HHhcCCChhhhhc
Q 000080 1455 NAAILGRWAALMRATA-LNRCGLPLEALDC 1483 (2389)
Q Consensus 1455 ~~~~~~r~~~l~~a~~-l~RmGC~lLALdl 1483 (2389)
++...+||.|++++++ |+|||||+|||+|
T Consensus 602 ~i~~~~E~~fvl~~a~~y~RmGCd~LaL~L 631 (631)
T PF12234_consen 602 KISPKEEFEFVLRVARIYDRMGCDLLALSL 631 (631)
T ss_pred cCCcHHHHHHHHHHHHHHHHcCCchhhccC
Confidence 9999999988888766 8999999999986
No 3
>KOG0645 consensus WD40 repeat protein [General function prediction only]
Probab=99.96 E-value=2.3e-29 Score=284.98 Aligned_cols=165 Identities=25% Similarity=0.499 Sum_probs=146.2
Q ss_pred eeeeeccCCCCCeeEEEEcCCCCCCCcEEEe--cCCeEEEEeeCCCCCCCCccceeeEEec--ccceEEEEeecCCCCeE
Q 000080 85 RQVFALSDNSLPVTSISWSPETPSIGQLAAA--SENCIFVFAHDSASSKGSFCWSQNAILV--QGTKVEAIEWTGSGDGI 160 (2389)
Q Consensus 85 ~Qviegh~d~~dVk~VaWSPd~~~~GeIaAS--yDntIRVw~~d~~~~kgd~~W~~~~tL~--hssTV~sIAWSpdG~rL 160 (2389)
-|.++||.+ +||.|||||- .|.|+|+ .|++||||...+ ...|.|+.+|. |+++||+|||+|+|++|
T Consensus 7 ~~~~~gh~~--r~W~~awhp~---~g~ilAscg~Dk~vriw~~~~-----~~s~~ck~vld~~hkrsVRsvAwsp~g~~L 76 (312)
T KOG0645|consen 7 EQKLSGHKD--RVWSVAWHPG---KGVILASCGTDKAVRIWSTSS-----GDSWTCKTVLDDGHKRSVRSVAWSPHGRYL 76 (312)
T ss_pred EEeecCCCC--cEEEEEeccC---CceEEEeecCCceEEEEecCC-----CCcEEEEEeccccchheeeeeeecCCCcEE
Confidence 478899988 9999999992 3778875 479999998761 22599999995 89999999999999999
Q ss_pred EEEecc--eEEeeccCCcEEEEEEeeccccceEE-EEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCcccee
Q 000080 161 VAGGME--TVLWKKKNTLWEIAWKFKENYPQNLV-SATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIK 236 (2389)
Q Consensus 161 aSggdD--V~IW~~~~s~Wecvwt~~~~~~~~iv-svaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ 236 (2389)
|++|+| +.||+...+.|||+.++ ++|+++| +|+||++|. +|||+++ |+||||+.+++.+|++
T Consensus 77 a~aSFD~t~~Iw~k~~~efecv~~l--EGHEnEVK~Vaws~sG~~LATCSRD------------KSVWiWe~deddEfec 142 (312)
T KOG0645|consen 77 ASASFDATVVIWKKEDGEFECVATL--EGHENEVKCVAWSASGNYLATCSRD------------KSVWIWEIDEDDEFEC 142 (312)
T ss_pred EEeeccceEEEeecCCCceeEEeee--eccccceeEEEEcCCCCEEEEeeCC------------CeEEEEEecCCCcEEE
Confidence 999999 99999999999999775 5678888 899999999 9999998 7899999997777776
Q ss_pred --ecccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeec
Q 000080 237 --LELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMD 286 (2389)
Q Consensus 237 --ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d 286 (2389)
+.+.|+|||++|.||| ..++|+|||||+|||+|++.+
T Consensus 143 ~aVL~~HtqDVK~V~WHP-------------t~dlL~S~SYDnTIk~~~~~~ 181 (312)
T KOG0645|consen 143 IAVLQEHTQDVKHVIWHP-------------TEDLLFSCSYDNTIKVYRDED 181 (312)
T ss_pred EeeeccccccccEEEEcC-------------CcceeEEeccCCeEEEEeecC
Confidence 6899999999999999 368999999999999999886
No 4
>KOG0645 consensus WD40 repeat protein [General function prediction only]
Probab=99.95 E-value=3.2e-27 Score=267.71 Aligned_cols=201 Identities=18% Similarity=0.276 Sum_probs=164.5
Q ss_pred CCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEE-
Q 000080 36 APTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAA- 114 (2389)
Q Consensus 36 ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaA- 114 (2389)
+|-.++..++|+++ | ..+|=++-+.-|=.|=-+-...|++. .+|+.|.+ |||.|.||| +.+||+
T Consensus 103 GHEnEVK~Vaws~s--G-~~LATCSRDKSVWiWe~deddEfec~------aVL~~Htq--DVK~V~WHP----t~dlL~S 167 (312)
T KOG0645|consen 103 GHENEVKCVAWSAS--G-NYLATCSRDKSVWIWEIDEDDEFECI------AVLQEHTQ--DVKHVIWHP----TEDLLFS 167 (312)
T ss_pred ccccceeEEEEcCC--C-CEEEEeeCCCeEEEEEecCCCcEEEE------eeeccccc--cccEEEEcC----CcceeEE
Confidence 78999999999998 7 58888876666655511234568888 99999855 999999999 577774
Q ss_pred -ecCCeEEEEeeCCCCCCCCccceeeEEec-ccceEEEEeecCCCCeEEEEecc--eEEeeccCCcEEEEEEeeccccce
Q 000080 115 -ASENCIFVFAHDSASSKGSFCWSQNAILV-QGTKVEAIEWTGSGDGIVAGGME--TVLWKKKNTLWEIAWKFKENYPQN 190 (2389)
Q Consensus 115 -SyDntIRVw~~d~~~~kgd~~W~~~~tL~-hssTV~sIAWSpdG~rLaSggdD--V~IW~~~~s~Wecvwt~~~~~~~~ 190 (2389)
|||||||+|+.++ +.+|.|.++|. |++|||+++|++.|+||+||++| |+||..- +.....|.+.
T Consensus 168 ~SYDnTIk~~~~~~-----dddW~c~~tl~g~~~TVW~~~F~~~G~rl~s~sdD~tv~Iw~~~-------~~~~~~~sr~ 235 (312)
T KOG0645|consen 168 CSYDNTIKVYRDED-----DDDWECVQTLDGHENTVWSLAFDNIGSRLVSCSDDGTVSIWRLY-------TDLSGMHSRA 235 (312)
T ss_pred eccCCeEEEEeecC-----CCCeeEEEEecCccceEEEEEecCCCceEEEecCCcceEeeeec-------cCcchhcccc
Confidence 6899999999872 44799999997 78899999999999999999998 9999754 3345788899
Q ss_pred EEEEeecCCCceEeeecccc---cccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccC
Q 000080 191 LVSATWSIEGPSATAASMSQ---LDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQR 267 (2389)
Q Consensus 191 ivsvaWSpdG~fATag~dik---f~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~ 267 (2389)
+|.++|. +|.|||+|+|-+ |++. +..+.|.|-. +...+++|.++||+|+|+| .++
T Consensus 236 ~Y~v~W~-~~~IaS~ggD~~i~lf~~s--~~~d~p~~~l-------~~~~~~aHe~dVNsV~w~p------------~~~ 293 (312)
T KOG0645|consen 236 LYDVPWD-NGVIASGGGDDAIRLFKES--DSPDEPSWNL-------LAKKEGAHEVDVNSVQWNP------------KVS 293 (312)
T ss_pred eEeeeec-ccceEeccCCCEEEEEEec--CCCCCchHHH-------HHhhhcccccccceEEEcC------------CCC
Confidence 9999999 999999999655 5555 3344555522 4446899999999999999 468
Q ss_pred ceEEeeecCCeEEEEEee
Q 000080 268 HVLLTCCLDGTVRLWCEM 285 (2389)
Q Consensus 268 nILAScSdDgTVRLW~e~ 285 (2389)
++|+||+|||+||+|...
T Consensus 294 ~~L~s~~DDG~v~~W~l~ 311 (312)
T KOG0645|consen 294 NRLASGGDDGIVNFWELE 311 (312)
T ss_pred CceeecCCCceEEEEEec
Confidence 899999999999999864
No 5
>KOG0276 consensus Vesicle coat complex COPI, beta' subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.93 E-value=4e-26 Score=276.70 Aligned_cols=175 Identities=21% Similarity=0.355 Sum_probs=159.6
Q ss_pred ccccccccccceeeccccccccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc-eeeEecccCCC
Q 000080 2185 AFGIPGYAGIGASALGWETQDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK-ATATYGVLPAA 2263 (2389)
Q Consensus 2185 ~~~~~g~~~~~Asg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk-~l~Tl~vl~gh 2263 (2389)
-|-++|+|||..++|+|+|.+++.+| +|+.++| |+|+.||+.|+++|+|+|.+||+||++.+. |.++|.
T Consensus 68 nWiv~GsDD~~IrVfnynt~ekV~~F---eAH~DyI--R~iavHPt~P~vLtsSDDm~iKlW~we~~wa~~qtfe----- 137 (794)
T KOG0276|consen 68 NWIVTGSDDMQIRVFNYNTGEKVKTF---EAHSDYI--RSIAVHPTLPYVLTSSDDMTIKLWDWENEWACEQTFE----- 137 (794)
T ss_pred ceEEEecCCceEEEEecccceeeEEe---eccccce--eeeeecCCCCeEEecCCccEEEEeeccCceeeeeEEc-----
Confidence 47789999999999999999999999 7888877 999999999999999999999999999885 788884
Q ss_pred CCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecC-CCCEEEEeecCC
Q 000080 2264 NVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITS-SGSVIAAAGHSS 2341 (2389)
Q Consensus 2264 ~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~-DGslLASAG~sS 2341 (2389)
||++.|++|+|+|.. ++|||||.|+|||+|++.+. .|.+|++||...|++|.|.|. |..+|.|| +
T Consensus 138 -----GH~HyVMqv~fnPkD~ntFaS~sLDrTVKVWslgs~-----~~nfTl~gHekGVN~Vdyy~~gdkpylIsg---a 204 (794)
T KOG0276|consen 138 -----GHEHYVMQVAFNPKDPNTFASASLDRTVKVWSLGSP-----HPNFTLEGHEKGVNCVDYYTGGDKPYLISG---A 204 (794)
T ss_pred -----CcceEEEEEEecCCCccceeeeeccccEEEEEcCCC-----CCceeeeccccCcceEEeccCCCcceEEec---C
Confidence 678999999999986 89999999999999999864 689999999999999999983 23488886 6
Q ss_pred CCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080 2342 NGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2342 ~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
+|.||||||. ++.+|+++|+||++.|..+.|+|..-.+.|-
T Consensus 205 DD~tiKvWDy--Qtk~CV~TLeGHt~Nvs~v~fhp~lpiiisg 245 (794)
T KOG0276|consen 205 DDLTIKVWDY--QTKSCVQTLEGHTNNVSFVFFHPELPIIISG 245 (794)
T ss_pred CCceEEEeec--chHHHHHHhhcccccceEEEecCCCcEEEEe
Confidence 9999999998 7899999999999999999999998887763
No 6
>KOG0318 consensus WD40 repeat stress protein/actin interacting protein [Cytoskeleton]
Probab=99.90 E-value=2.3e-22 Score=241.93 Aligned_cols=288 Identities=19% Similarity=0.252 Sum_probs=201.6
Q ss_pred ccccccccCCCCCCCcceeec-CCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCC
Q 000080 27 FLRSEFIPTAPTRSTSTIDWL-PDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPE 105 (2389)
Q Consensus 27 ~~~~~~ip~ap~~~~~ai~wl-pD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd 105 (2389)
....+++||-|.|.|++..-+ .|++| .-|+|..|..+++++|++|... +++..|.+ +|+.+++||
T Consensus 4 ~~lk~~~~~lPst~Rg~~~~ig~dpkg-d~ilY~nGksv~ir~i~~~~~~----------~iYtEH~~--~vtVAkySP- 69 (603)
T KOG0318|consen 4 YELKETFASLPSTERGVPIIIGGDPKG-DNILYTNGKSVIIRNIDNPASV----------DIYTEHAH--QVTVAKYSP- 69 (603)
T ss_pred hhhhhhccCCCcccCCcceEeccCCCC-CeEEEeCCCEEEEEECCCccce----------eeeccccc--eeEEEEeCC-
Confidence 456899999999999999998 99999 6999999999999999998876 45556766 999999999
Q ss_pred CCCCCcEEEecC--CeEEEEeeCCCCCCCCccceeeEEe-cccceEEEEeecCCCCeEEEEecc------eEEeeccCCc
Q 000080 106 TPSIGQLAAASE--NCIFVFAHDSASSKGSFCWSQNAIL-VQGTKVEAIEWTGSGDGIVAGGME------TVLWKKKNTL 176 (2389)
Q Consensus 106 ~~~~GeIaASyD--ntIRVw~~d~~~~kgd~~W~~~~tL-~hssTV~sIAWSpdG~rLaSggdD------V~IW~~~~s~ 176 (2389)
+|+.+||+| ++||||.-.. .+-..+..+ +..++|-+|+|+++|+||+++|++ +-+|+.+++.
T Consensus 70 ---sG~yiASGD~sG~vRIWdtt~------~~hiLKnef~v~aG~I~Di~Wd~ds~RI~avGEGrerfg~~F~~DSG~Sv 140 (603)
T KOG0318|consen 70 ---SGFYIASGDVSGKVRIWDTTQ------KEHILKNEFQVLAGPIKDISWDFDSKRIAAVGEGRERFGHVFLWDSGNSV 140 (603)
T ss_pred ---CceEEeecCCcCcEEEEeccC------cceeeeeeeeecccccccceeCCCCcEEEEEecCccceeEEEEecCCCcc
Confidence 699999987 9999997651 022333333 478999999999999999999996 5599976555
Q ss_pred EEEEEEe--------------------------------------eccccceEEEEeecCCCc-eEeeecccccccCCCC
Q 000080 177 WEIAWKF--------------------------------------KENYPQNLVSATWSIEGP-SATAASMSQLDLLGPK 217 (2389)
Q Consensus 177 Wecvwt~--------------------------------------~~~~~~~ivsvaWSpdG~-fATag~dikf~~~~~~ 217 (2389)
.|...+. ..+|..=+.+|.+||||. |||+|.|.|
T Consensus 141 Gei~GhSr~ins~~~KpsRPfRi~T~sdDn~v~ffeGPPFKFk~s~r~HskFV~~VRysPDG~~Fat~gsDgk------- 213 (603)
T KOG0318|consen 141 GEITGHSRRINSVDFKPSRPFRIATGSDDNTVAFFEGPPFKFKSSFREHSKFVNCVRYSPDGSRFATAGSDGK------- 213 (603)
T ss_pred ceeeccceeEeeeeccCCCceEEEeccCCCeEEEeeCCCeeeeecccccccceeeEEECCCCCeEEEecCCcc-------
Confidence 4443322 223333333999999999 999999987
Q ss_pred CCCceeEEEeeCCCccceee----cccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeecCCcccc-
Q 000080 218 EAGKCVFICCSDGKSEYIKL----ELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMDSGKTRK- 292 (2389)
Q Consensus 218 ~~~kpV~V~~~dg~~~~~~v----e~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d~Gk~kk- 292 (2389)
+..+||+.+.... ..+|...|++++|+| |+++ +||+|.|.|+|||+...+-..|+
T Consensus 214 -------i~iyDGktge~vg~l~~~~aHkGsIfalsWsP--------Ds~~-----~~T~SaDkt~KIWdVs~~slv~t~ 273 (603)
T KOG0318|consen 214 -------IYIYDGKTGEKVGELEDSDAHKGSIFALSWSP--------DSTQ-----FLTVSADKTIKIWDVSTNSLVSTW 273 (603)
T ss_pred -------EEEEcCCCccEEEEecCCCCccccEEEEEECC--------CCce-----EEEecCCceEEEEEeeccceEEEe
Confidence 3345666543322 358999999999999 9999 99999999999999776533333
Q ss_pred -cccccCC-------CCccceeEEEEEEEeecccccCCCCCCeEEEeeccccceeeccCCccceecccccccccceeeee
Q 000080 293 -VAKDTND-------HKTIRRSFCVGAIIEINQALNGALGMDIVITWAKEIRCMFETGEGANHFISTGVYEHGGTGKCEW 364 (2389)
Q Consensus 293 -~~~~~~d-------~~~~~~sF~vaA~I~~~~~~~~~l~~~~~v~W~~~~~~vf~~~~e~~~~~~s~~~~~~~v~~~eW 364 (2389)
.++.+-| ||....+-.+--.||+=+ ..| +.+..+.=.-||..---+--..+.++.++.|| -..++|
T Consensus 274 ~~~~~v~dqqvG~lWqkd~lItVSl~G~in~ln-~~d--~~~~~~i~GHnK~ITaLtv~~d~~~i~SgsyD---G~I~~W 347 (603)
T KOG0318|consen 274 PMGSTVEDQQVGCLWQKDHLITVSLSGTINYLN-PSD--PSVLKVISGHNKSITALTVSPDGKTIYSGSYD---GHINSW 347 (603)
T ss_pred ecCCchhceEEEEEEeCCeEEEEEcCcEEEEec-ccC--CChhheecccccceeEEEEcCCCCEEEeeccC---ceEEEE
Confidence 3333333 344446666666666322 122 22333433444432211111113456666665 356778
Q ss_pred eEeecC
Q 000080 365 LVGYGP 370 (2389)
Q Consensus 365 ~~~~~P 370 (2389)
..+-+-
T Consensus 348 ~~~~g~ 353 (603)
T KOG0318|consen 348 DSGSGT 353 (603)
T ss_pred ecCCcc
Confidence 765443
No 7
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=99.88 E-value=7.4e-23 Score=242.09 Aligned_cols=173 Identities=16% Similarity=0.186 Sum_probs=152.1
Q ss_pred ccccceeeccccccccccccccCCC--CcC--ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCC
Q 000080 2191 YAGIGASALGWETQDDFEDYVDPPA--TVE--NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVP 2266 (2389)
Q Consensus 2191 ~~~~~Asg~~~d~~~~~~~~~d~~a--tv~--ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p 2266 (2389)
++.+++++ .+|.+=|+|+...... ..+ .-+|.+|+|+|||.+++|||.|..-|+||+++|+++..|.
T Consensus 272 sG~~L~Ta-sfD~tWRlWD~~tk~ElL~QEGHs~~v~~iaf~~DGSL~~tGGlD~~~RvWDlRtgr~im~L~-------- 342 (459)
T KOG0272|consen 272 SGKFLGTA-SFDSTWRLWDLETKSELLLQEGHSKGVFSIAFQPDGSLAATGGLDSLGRVWDLRTGRCIMFLA-------- 342 (459)
T ss_pred CCceeeec-ccccchhhcccccchhhHhhcccccccceeEecCCCceeeccCccchhheeecccCcEEEEec--------
Confidence 34567778 9999999998841111 111 2366999999999999999999999999999999998884
Q ss_pred CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080 2267 PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus 2267 ~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
||...|.+|+|||+|..|||||.|+|+|+||++.. +++.+..+|++-|+.|.|+|+.|.+|+|+ |.|+|+
T Consensus 343 --gH~k~I~~V~fsPNGy~lATgs~Dnt~kVWDLR~r-----~~ly~ipAH~nlVS~Vk~~p~~g~fL~Ta---syD~t~ 412 (459)
T KOG0272|consen 343 --GHIKEILSVAFSPNGYHLATGSSDNTCKVWDLRMR-----SELYTIPAHSNLVSQVKYSPQEGYFLVTA---SYDNTV 412 (459)
T ss_pred --ccccceeeEeECCCceEEeecCCCCcEEEeeeccc-----ccceecccccchhhheEecccCCeEEEEc---ccCcce
Confidence 68899999999999999999999999999999953 56899999999999999999899999997 589999
Q ss_pred EEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080 2347 VVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2347 rLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
+||.. .+..++++|+||++.|-+++.+++|.++++-
T Consensus 413 kiWs~--~~~~~~ksLaGHe~kV~s~Dis~d~~~i~t~ 448 (459)
T KOG0272|consen 413 KIWST--RTWSPLKSLAGHEGKVISLDISPDSQAIATS 448 (459)
T ss_pred eeecC--CCcccchhhcCCccceEEEEeccCCceEEEe
Confidence 99998 5778899999999999999999999998863
No 8
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=99.87 E-value=1.1e-22 Score=240.60 Aligned_cols=173 Identities=18% Similarity=0.192 Sum_probs=150.9
Q ss_pred cc-ccccceeeccccccccccccc--cCCCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCC
Q 000080 2189 PG-YAGIGASALGWETQDDFEDYV--DPPATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAA 2263 (2389)
Q Consensus 2189 ~g-~~~~~Asg~~~d~~~~~~~~~--d~~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh 2263 (2389)
|+ .+.-+|++ +.|.+.++|.+. .++++++. .+|.+|+|||+|++|+|+|.|.|-||||+.+++.+.-.
T Consensus 227 P~~~~~~lat~-s~Dgtvklw~~~~e~~l~~l~gH~~RVs~VafHPsG~~L~TasfD~tWRlWD~~tk~ElL~Q------ 299 (459)
T KOG0272|consen 227 PVDSDLNLATA-SADGTVKLWKLSQETPLQDLEGHLARVSRVAFHPSGKFLGTASFDSTWRLWDLETKSELLLQ------ 299 (459)
T ss_pred cCCCccceeee-ccCCceeeeccCCCcchhhhhcchhhheeeeecCCCceeeecccccchhhcccccchhhHhh------
Confidence 55 45578888 999999999986 34455554 57799999999999999999999999999999875432
Q ss_pred CCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCC
Q 000080 2264 NVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNG 2343 (2389)
Q Consensus 2264 ~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D 2343 (2389)
-||+..|.+|+|.|||..+|||+.|..=|+||+++| +++..+.||.+.|.+|+|+| +|..|||+ |.|
T Consensus 300 ----EGHs~~v~~iaf~~DGSL~~tGGlD~~~RvWDlRtg-----r~im~L~gH~k~I~~V~fsP-NGy~lATg---s~D 366 (459)
T KOG0272|consen 300 ----EGHSKGVFSIAFQPDGSLAATGGLDSLGRVWDLRTG-----RCIMFLAGHIKEILSVAFSP-NGYHLATG---SSD 366 (459)
T ss_pred ----cccccccceeEecCCCceeeccCccchhheeecccC-----cEEEEecccccceeeEeECC-CceEEeec---CCC
Confidence 267899999999999999999999999999999998 47889999999999999999 99999996 699
Q ss_pred CeEEEeeCCCCCCCceEEEEeecCcEEEEeecc-cchhhhc
Q 000080 2344 INVVVWDTLAPPTSSRASITCHEGLYDLFLPLK-LLNFALS 2383 (2389)
Q Consensus 2344 ~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~-~~~~~~s 2383 (2389)
+|+||||+. ..+++.++.+|++-|+-|-++| -|.|.++
T Consensus 367 nt~kVWDLR--~r~~ly~ipAH~nlVS~Vk~~p~~g~fL~T 405 (459)
T KOG0272|consen 367 NTCKVWDLR--MRSELYTIPAHSNLVSQVKYSPQEGYFLVT 405 (459)
T ss_pred CcEEEeeec--ccccceecccccchhhheEecccCCeEEEE
Confidence 999999984 4566999999999999999998 6777665
No 9
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=99.83 E-value=1.7e-20 Score=219.88 Aligned_cols=135 Identities=16% Similarity=0.233 Sum_probs=122.0
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.|-+++|+|+|..|||||.|.|+||||..+.....|.+ ||.+||.+|++||||+.||||+.||+|+|||.
T Consensus 117 ~Vl~~~fsp~g~~l~tGsGD~TvR~WD~~TeTp~~t~K----------gH~~WVlcvawsPDgk~iASG~~dg~I~lwdp 186 (480)
T KOG0271|consen 117 AVLSVQFSPTGSRLVTGSGDTTVRLWDLDTETPLFTCK----------GHKNWVLCVAWSPDGKKIASGSKDGSIRLWDP 186 (480)
T ss_pred cEEEEEecCCCceEEecCCCceEEeeccCCCCcceeec----------CCccEEEEEEECCCcchhhccccCCeEEEecC
Confidence 56889999999999999999999999999988888874 67899999999999999999999999999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecC----CCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITS----SGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~----DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
++|+ +...++.||..+|.+++|-|- .+++|||+ |.|++|||||+. .++|+.++.||++.|+||--
T Consensus 187 ktg~----~~g~~l~gH~K~It~Lawep~hl~p~~r~las~---skDg~vrIWd~~--~~~~~~~lsgHT~~VTCvrw 255 (480)
T KOG0271|consen 187 KTGQ----QIGRALRGHKKWITALAWEPLHLVPPCRRLASS---SKDGSVRIWDTK--LGTCVRTLSGHTASVTCVRW 255 (480)
T ss_pred CCCC----cccccccCcccceeEEeecccccCCCccceecc---cCCCCEEEEEcc--CceEEEEeccCccceEEEEE
Confidence 9985 456889999999999999863 66799985 699999999983 57899999999999999864
No 10
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=99.83 E-value=8.1e-20 Score=226.99 Aligned_cols=145 Identities=18% Similarity=0.277 Sum_probs=131.7
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeec-CCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEF-GKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl-~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
-.|+.++|+|||+++++|+.|++||+||+ .++.+++++. ||...|++++|+|+|+.++||+.|+|||+|
T Consensus 204 ~~v~~~~fs~d~~~l~s~s~D~tiriwd~~~~~~~~~~l~----------gH~~~v~~~~f~p~g~~i~Sgs~D~tvriW 273 (456)
T KOG0266|consen 204 RGVSDVAFSPDGSYLLSGSDDKTLRIWDLKDDGRNLKTLK----------GHSTYVTSVAFSPDGNLLVSGSDDGTVRIW 273 (456)
T ss_pred cceeeeEECCCCcEEEEecCCceEEEeeccCCCeEEEEec----------CCCCceEEEEecCCCCEEEEecCCCcEEEE
Confidence 46799999999999999999999999999 5668888884 578999999999999999999999999999
Q ss_pred eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCC--ceEEEEeecCc--EEEEee
Q 000080 2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTS--SRASITCHEGL--YDLFLP 2374 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~--~v~sL~GH~~~--V~svA~ 2374 (2389)
|++++ ++...+.+|+..|++++|++ ||++|+++ +.|++|+|||+ .++. ++..+.+|++. ++++.+
T Consensus 274 d~~~~-----~~~~~l~~hs~~is~~~f~~-d~~~l~s~---s~d~~i~vwd~--~~~~~~~~~~~~~~~~~~~~~~~~f 342 (456)
T KOG0266|consen 274 DVRTG-----ECVRKLKGHSDGISGLAFSP-DGNLLVSA---SYDGTIRVWDL--ETGSKLCLKLLSGAENSAPVTSVQF 342 (456)
T ss_pred eccCC-----eEEEeeeccCCceEEEEECC-CCCEEEEc---CCCccEEEEEC--CCCceeeeecccCCCCCCceeEEEE
Confidence 99986 58899999999999999999 99999996 57999999998 4566 67899999988 999999
Q ss_pred cccchhhhccc
Q 000080 2375 LKLLNFALSKC 2385 (2389)
Q Consensus 2375 ~~~~~~~~s~~ 2385 (2389)
+|+|.++++..
T Consensus 343 sp~~~~ll~~~ 353 (456)
T KOG0266|consen 343 SPNGKYLLSAS 353 (456)
T ss_pred CCCCcEEEEec
Confidence 99999988754
No 11
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=99.82 E-value=3.7e-20 Score=231.58 Aligned_cols=144 Identities=24% Similarity=0.287 Sum_probs=133.9
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
.+|..++|+|+.++|+|+|+|++||||.+.+-.++..|+ ||..+|+.|+|+|-|-+|||||.|+|-+||.
T Consensus 452 GPVyg~sFsPd~rfLlScSED~svRLWsl~t~s~~V~y~----------GH~~PVwdV~F~P~GyYFatas~D~tArLWs 521 (707)
T KOG0263|consen 452 GPVYGCSFSPDRRFLLSCSEDSSVRLWSLDTWSCLVIYK----------GHLAPVWDVQFAPRGYYFATASHDQTARLWS 521 (707)
T ss_pred CceeeeeecccccceeeccCCcceeeeecccceeEEEec----------CCCcceeeEEecCCceEEEecCCCceeeeee
Confidence 467999999999999999999999999999999999985 4667899999999999999999999999998
Q ss_pred CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccch
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~ 2379 (2389)
.... +|++.+.||.+.|.+|+|+| ++.++||| |.|+|||+||+ .+|.+|+.|.||.+.|.+|+++|.|+
T Consensus 522 ~d~~-----~PlRifaghlsDV~cv~FHP-Ns~Y~aTG---SsD~tVRlWDv--~~G~~VRiF~GH~~~V~al~~Sp~Gr 590 (707)
T KOG0263|consen 522 TDHN-----KPLRIFAGHLSDVDCVSFHP-NSNYVATG---SSDRTVRLWDV--STGNSVRIFTGHKGPVTALAFSPCGR 590 (707)
T ss_pred cccC-----CchhhhcccccccceEEECC-cccccccC---CCCceEEEEEc--CCCcEEEEecCCCCceEEEEEcCCCc
Confidence 8753 79999999999999999999 89999995 69999999998 68999999999999999999999999
Q ss_pred hhhcc
Q 000080 2380 FALSK 2384 (2389)
Q Consensus 2380 ~~~s~ 2384 (2389)
|..|-
T Consensus 591 ~LaSg 595 (707)
T KOG0263|consen 591 YLASG 595 (707)
T ss_pred eEeec
Confidence 98763
No 12
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=99.81 E-value=4e-19 Score=203.27 Aligned_cols=225 Identities=18% Similarity=0.185 Sum_probs=174.4
Q ss_pred ceeeeeecccCCCcceEEeecccceEEeeecccccccccccceeccCCCCCCCCCCCcccccCCccCCCccccCCCC-cc
Q 000080 2082 ELFEALCVNSIDQRQGAIASNRKGIVFFNLEDEIPLHDQLKYIWADADWPQNGWAGSESTPVPTFVSPGVGLGSNKG-AH 2160 (2389)
Q Consensus 2082 ~~~~a~~~n~~n~~~~~~a~~~k~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~s~p~~~~~s~~~g~~~~~g-~~ 2160 (2389)
+-|.+++|..-|++.++=||.-|-++-.++.-. ||.- |+-..+.+| +|
T Consensus 16 d~Vt~la~~~~~~~~l~sasrDk~ii~W~L~~d--------------d~~~-----------------G~~~r~~~GHsH 64 (315)
T KOG0279|consen 16 DWVTALAIKIKNSDILVSASRDKTIIVWKLTSD--------------DIKY-----------------GVPVRRLTGHSH 64 (315)
T ss_pred ceEEEEEeecCCCceEEEcccceEEEEEEeccC--------------cccc-----------------Cceeeeeeccce
Confidence 457899999999988888888888855444322 3332 333667888 55
Q ss_pred cccCCcccccccccCCCccccCccccccccccccceeeccccccccccccccCCCCc--Cc--eeEEEEEEcCCCCeEEE
Q 000080 2161 LGLGGATIGVGSLARPGRDLTGGLAFGIPGYAGIGASALGWETQDDFEDYVDPPATV--EN--ISTRAFSSHPLRPFFLV 2236 (2389)
Q Consensus 2161 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~g~~~~~Asg~~~d~~~~~~~~~d~~atv--~n--i~VrsVAFsPdG~~LAS 2236 (2389)
.--+.+-+ ..| -+..++ +||.+-|+|+......+. .+ --|-+|+|+||.+.|+|
T Consensus 65 ~v~dv~~s-------------~dg--------~~alS~-swD~~lrlWDl~~g~~t~~f~GH~~dVlsva~s~dn~qivS 122 (315)
T KOG0279|consen 65 FVSDVVLS-------------SDG--------NFALSA-SWDGTLRLWDLATGESTRRFVGHTKDVLSVAFSTDNRQIVS 122 (315)
T ss_pred EecceEEc-------------cCC--------ceEEec-cccceEEEEEecCCcEEEEEEecCCceEEEEecCCCceeec
Confidence 54433311 111 224566 999999999985432221 11 24589999999999999
Q ss_pred EeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC--CCEEEEEeCCCcEEEeeCCCCCccCcccceee
Q 000080 2237 GSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY--GHRFASAALDGTVCTWQLEVGGRSNVRPMESC 2314 (2389)
Q Consensus 2237 GS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD--G~~LASgS~DgTVkLWDl~tggrs~~k~l~tl 2314 (2389)
||.|.||+|||+ -|.|..|.. .+ +|.++|.+|.|+|. .-.|+++|.|+|||+||+++- +...++
T Consensus 123 GSrDkTiklwnt-~g~ck~t~~---~~-----~~~~WVscvrfsP~~~~p~Ivs~s~DktvKvWnl~~~-----~l~~~~ 188 (315)
T KOG0279|consen 123 GSRDKTIKLWNT-LGVCKYTIH---ED-----SHREWVSCVRFSPNESNPIIVSASWDKTVKVWNLRNC-----QLRTTF 188 (315)
T ss_pred CCCcceeeeeee-cccEEEEEe---cC-----CCcCcEEEEEEcCCCCCcEEEEccCCceEEEEccCCc-----chhhcc
Confidence 999999999998 578887764 11 34799999999999 679999999999999999863 456788
Q ss_pred eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080 2315 LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus 2315 ~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
.||++.++.+++|| ||.+.|+|| .|+.+-|||+ ..++++++|. |-..|.+++|+|---|
T Consensus 189 ~gh~~~v~t~~vSp-DGslcasGg---kdg~~~LwdL--~~~k~lysl~-a~~~v~sl~fspnryw 247 (315)
T KOG0279|consen 189 IGHSGYVNTVTVSP-DGSLCASGG---KDGEAMLWDL--NEGKNLYSLE-AFDIVNSLCFSPNRYW 247 (315)
T ss_pred ccccccEEEEEECC-CCCEEecCC---CCceEEEEEc--cCCceeEecc-CCCeEeeEEecCCcee
Confidence 99999999999999 999999975 9999999998 4678899998 8889999999997544
No 13
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=99.81 E-value=1.2e-19 Score=227.00 Aligned_cols=139 Identities=22% Similarity=0.365 Sum_probs=118.0
Q ss_pred eeeccccccccccccc--cCCCCcC--ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCC
Q 000080 2196 ASALGWETQDDFEDYV--DPPATVE--NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYAL 2271 (2389)
Q Consensus 2196 Asg~~~d~~~~~~~~~--d~~atv~--ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~ 2271 (2389)
|++ +.|.+.++|... +|.+-.- .--|.+++|||+..++|+||.|.|||+||+.+|..++.|. ||.
T Consensus 509 ata-s~D~tArLWs~d~~~PlRifaghlsDV~cv~FHPNs~Y~aTGSsD~tVRlWDv~~G~~VRiF~----------GH~ 577 (707)
T KOG0263|consen 509 ATA-SHDQTARLWSTDHNKPLRIFAGHLSDVDCVSFHPNSNYVATGSSDRTVRLWDVSTGNSVRIFT----------GHK 577 (707)
T ss_pred Eec-CCCceeeeeecccCCchhhhcccccccceEEECCcccccccCCCCceEEEEEcCCCcEEEEec----------CCC
Confidence 455 566666777542 3333311 1234889999999999999999999999999999999984 678
Q ss_pred CCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2272 ASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2272 ~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
+.|.+|+|||+|++||||+.||.|++||+.+| +++.++.+|++.|+++.|+. ||.+||++| .|++|+|||+
T Consensus 578 ~~V~al~~Sp~Gr~LaSg~ed~~I~iWDl~~~-----~~v~~l~~Ht~ti~SlsFS~-dg~vLasgg---~DnsV~lWD~ 648 (707)
T KOG0263|consen 578 GPVTALAFSPCGRYLASGDEDGLIKIWDLANG-----SLVKQLKGHTGTIYSLSFSR-DGNVLASGG---ADNSVRLWDL 648 (707)
T ss_pred CceEEEEEcCCCceEeecccCCcEEEEEcCCC-----cchhhhhcccCceeEEEEec-CCCEEEecC---CCCeEEEEEc
Confidence 99999999999999999999999999999987 47888999999999999999 999999974 8999999998
Q ss_pred CCC
Q 000080 2352 LAP 2354 (2389)
Q Consensus 2352 l~~ 2354 (2389)
...
T Consensus 649 ~~~ 651 (707)
T KOG0263|consen 649 TKV 651 (707)
T ss_pred hhh
Confidence 543
No 14
>KOG0319 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.80 E-value=2.2e-19 Score=222.80 Aligned_cols=174 Identities=14% Similarity=0.184 Sum_probs=152.9
Q ss_pred cccccccceeeccccccccccccccCCCCcC-------------ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCcee
Q 000080 2188 IPGYAGIGASALGWETQDDFEDYVDPPATVE-------------NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKAT 2254 (2389)
Q Consensus 2188 ~~g~~~~~Asg~~~d~~~~~~~~~d~~atv~-------------ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l 2254 (2389)
-.|++...++| +-|-+.++|++.+...+.. .=.|.+|+.+|+.++|||||.|.|.|||++.+++..
T Consensus 420 ~~~~asffvsv-S~D~tlK~W~l~~s~~~~~~~~~~~~~t~~aHdKdIN~Vaia~ndkLiAT~SqDktaKiW~le~~~l~ 498 (775)
T KOG0319|consen 420 SKLGASFFVSV-SQDCTLKLWDLPKSKETAFPIVLTCRYTERAHDKDINCVAIAPNDKLIATGSQDKTAKIWDLEQLRLL 498 (775)
T ss_pred cccCccEEEEe-cCCceEEEecCCCcccccccceehhhHHHHhhcccccceEecCCCceEEecccccceeeecccCceEE
Confidence 45667778999 8888899998865212211 114688999999999999999999999999988888
Q ss_pred eEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEE
Q 000080 2255 ATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVI 2334 (2389)
Q Consensus 2255 ~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslL 2334 (2389)
.++. ||...|++|.|+|..+.+||+|.|+|||||.+.+. .++.++.||+..|..+.|.. +|+.|
T Consensus 499 ~vLs----------GH~RGvw~V~Fs~~dq~laT~SgD~TvKIW~is~f-----SClkT~eGH~~aVlra~F~~-~~~ql 562 (775)
T KOG0319|consen 499 GVLS----------GHTRGVWCVSFSKNDQLLATCSGDKTVKIWSISTF-----SCLKTFEGHTSAVLRASFIR-NGKQL 562 (775)
T ss_pred EEee----------CCccceEEEEeccccceeEeccCCceEEEEEeccc-----eeeeeecCccceeEeeeeee-CCcEE
Confidence 8884 67899999999999999999999999999999987 47999999999999999999 88999
Q ss_pred EEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080 2335 AAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2335 ASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
.|+| .||-||||++ .++.|+++|..|++.||.++-+++++++++
T Consensus 563 iS~~---adGliKlWni--kt~eC~~tlD~H~DrvWaL~~~~~~~~~~t 606 (775)
T KOG0319|consen 563 ISAG---ADGLIKLWNI--KTNECEMTLDAHNDRVWALSVSPLLDMFVT 606 (775)
T ss_pred Eecc---CCCcEEEEec--cchhhhhhhhhccceeEEEeecCccceeEe
Confidence 9975 8999999998 588999999999999999999999998874
No 15
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=99.78 E-value=1.5e-18 Score=199.24 Aligned_cols=167 Identities=18% Similarity=0.230 Sum_probs=133.7
Q ss_pred ccccccceeeccccccccccccccCCCCcCceeEEEEEEcC-CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCC
Q 000080 2189 PGYAGIGASALGWETQDDFEDYVDPPATVENISTRAFSSHP-LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPP 2267 (2389)
Q Consensus 2189 ~g~~~~~Asg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsP-dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~ 2267 (2389)
||++||-.----=++-+++..|..+... |-+++++| +++.++||+.|++.+|||++.|.++++|.
T Consensus 161 T~SGD~TCalWDie~g~~~~~f~GH~gD-----V~slsl~p~~~ntFvSg~cD~~aklWD~R~~~c~qtF~--------- 226 (343)
T KOG0286|consen 161 TGSGDMTCALWDIETGQQTQVFHGHTGD-----VMSLSLSPSDGNTFVSGGCDKSAKLWDVRSGQCVQTFE--------- 226 (343)
T ss_pred ecCCCceEEEEEcccceEEEEecCCccc-----EEEEecCCCCCCeEEecccccceeeeeccCcceeEeec---------
Confidence 5555555544222233344444333333 38899999 99999999999999999999999999983
Q ss_pred CCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080 2268 PYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus 2268 ~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
||...|.+|+|.|+|.-||+||+|+|.|++|++.. ++ -.+++...-...|++|+||- +|++|.++ ..|.++.
T Consensus 227 -ghesDINsv~ffP~G~afatGSDD~tcRlyDlRaD-~~--~a~ys~~~~~~gitSv~FS~-SGRlLfag---y~d~~c~ 298 (343)
T KOG0286|consen 227 -GHESDINSVRFFPSGDAFATGSDDATCRLYDLRAD-QE--LAVYSHDSIICGITSVAFSK-SGRLLFAG---YDDFTCN 298 (343)
T ss_pred -ccccccceEEEccCCCeeeecCCCceeEEEeecCC-cE--EeeeccCcccCCceeEEEcc-cccEEEee---ecCCcee
Confidence 67899999999999999999999999999999986 21 23333344457899999999 99999874 4899999
Q ss_pred EeeCCCCCCCceEEEEeecCcEEEEeecccch
Q 000080 2348 VWDTLAPPTSSRASITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus 2348 LWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~ 2379 (2389)
+||++ .++.+..|.||+|+|.||..+|+|-
T Consensus 299 vWDtl--k~e~vg~L~GHeNRvScl~~s~DG~ 328 (343)
T KOG0286|consen 299 VWDTL--KGERVGVLAGHENRVSCLGVSPDGM 328 (343)
T ss_pred Eeecc--ccceEEEeeccCCeeEEEEECCCCc
Confidence 99997 4567899999999999999999984
No 16
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=99.77 E-value=1.8e-18 Score=203.05 Aligned_cols=163 Identities=17% Similarity=0.165 Sum_probs=137.7
Q ss_pred ccceeeccccccccccccc--cCCCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCC
Q 000080 2193 GIGASALGWETQDDFEDYV--DPPATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPP 2268 (2389)
Q Consensus 2193 ~~~Asg~~~d~~~~~~~~~--d~~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~ 2268 (2389)
..+|+| +=|++.|+|+.. -|..|... ..|-+|+|+|||+.||||+-||+|+|||..+|+++-. +.+
T Consensus 128 ~~l~tG-sGD~TvR~WD~~TeTp~~t~KgH~~WVlcvawsPDgk~iASG~~dg~I~lwdpktg~~~g~---------~l~ 197 (480)
T KOG0271|consen 128 SRLVTG-SGDTTVRLWDLDTETPLFTCKGHKNWVLCVAWSPDGKKIASGSKDGSIRLWDPKTGQQIGR---------ALR 197 (480)
T ss_pred ceEEec-CCCceEEeeccCCCCcceeecCCccEEEEEEECCCcchhhccccCCeEEEecCCCCCcccc---------ccc
Confidence 457788 668999999874 33333332 4679999999999999999999999999999987532 124
Q ss_pred CCCCCEEEEEEC-----CCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCC
Q 000080 2269 YALASISALQFD-----HYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNG 2343 (2389)
Q Consensus 2269 GH~~~V~sVaFS-----PDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D 2343 (2389)
||..+|++++|- |..++|||+|.||+|+|||+..+ ++++++.||+..|.+|.+-. + .+|+|+ |.|
T Consensus 198 gH~K~It~Lawep~hl~p~~r~las~skDg~vrIWd~~~~-----~~~~~lsgHT~~VTCvrwGG-~-gliySg---S~D 267 (480)
T KOG0271|consen 198 GHKKWITALAWEPLHLVPPCRRLASSSKDGSVRIWDTKLG-----TCVRTLSGHTASVTCVRWGG-E-GLIYSG---SQD 267 (480)
T ss_pred CcccceeEEeecccccCCCccceecccCCCCEEEEEccCc-----eEEEEeccCccceEEEEEcC-C-ceEEec---CCC
Confidence 788999999986 67789999999999999999975 57899999999999999986 3 688885 799
Q ss_pred CeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080 2344 INVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus 2344 ~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
+|||+|+.. .|.+++.|.||..+|+.+|.+++
T Consensus 268 rtIkvw~a~--dG~~~r~lkGHahwvN~lalsTd 299 (480)
T KOG0271|consen 268 RTIKVWRAL--DGKLCRELKGHAHWVNHLALSTD 299 (480)
T ss_pred ceEEEEEcc--chhHHHhhcccchheeeeeccch
Confidence 999999984 58899999999999999998854
No 17
>KOG0295 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.77 E-value=3e-18 Score=200.88 Aligned_cols=173 Identities=14% Similarity=0.135 Sum_probs=145.4
Q ss_pred ccccccceeecccccccccccccc-------CCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccC
Q 000080 2189 PGYAGIGASALGWETQDDFEDYVD-------PPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLP 2261 (2389)
Q Consensus 2189 ~g~~~~~Asg~~~d~~~~~~~~~d-------~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~ 2261 (2389)
.+++..+|+- +-|.+..+|++.. ...+- ..|.+|+|=|.|.+|+|+|.|.||+.||+.+|.|+.+|.
T Consensus 159 ~a~Gk~l~tc-SsDl~~~LWd~~~~~~c~ks~~gh~--h~vS~V~f~P~gd~ilS~srD~tik~We~~tg~cv~t~~--- 232 (406)
T KOG0295|consen 159 DASGKYLATC-SSDLSAKLWDFDTFFRCIKSLIGHE--HGVSSVFFLPLGDHILSCSRDNTIKAWECDTGYCVKTFP--- 232 (406)
T ss_pred ecCccEEEec-CCccchhheeHHHHHHHHHHhcCcc--cceeeEEEEecCCeeeecccccceeEEecccceeEEecc---
Confidence 3344555665 5566677777642 22222 245999999999999999999999999999999999983
Q ss_pred CCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecC------------
Q 000080 2262 AANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITS------------ 2329 (2389)
Q Consensus 2262 gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~------------ 2329 (2389)
||..+|+.|+.+-||..+||+|.|.||++|=++++ .+...+.+|+..|.+++|.|.
T Consensus 233 -------~h~ewvr~v~v~~DGti~As~s~dqtl~vW~~~t~-----~~k~~lR~hEh~vEci~wap~~~~~~i~~at~~ 300 (406)
T KOG0295|consen 233 -------GHSEWVRMVRVNQDGTIIASCSNDQTLRVWVVATK-----QCKAELREHEHPVECIAWAPESSYPSISEATGS 300 (406)
T ss_pred -------CchHhEEEEEecCCeeEEEecCCCceEEEEEeccc-----hhhhhhhccccceEEEEecccccCcchhhccCC
Confidence 56789999999999999999999999999999986 355667889999999999874
Q ss_pred --CCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080 2330 --SGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2330 --DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
.|+.++++ |.|+|||+||+ +++.|+-+|.||.++|+.+|++|.|.|++|-
T Consensus 301 ~~~~~~l~s~---SrDktIk~wdv--~tg~cL~tL~ghdnwVr~~af~p~Gkyi~Sc 352 (406)
T KOG0295|consen 301 TNGGQVLGSG---SRDKTIKIWDV--STGMCLFTLVGHDNWVRGVAFSPGGKYILSC 352 (406)
T ss_pred CCCccEEEee---cccceEEEEec--cCCeEEEEEecccceeeeeEEcCCCeEEEEE
Confidence 23588775 79999999998 7999999999999999999999999999984
No 18
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=99.76 E-value=4.3e-18 Score=211.73 Aligned_cols=145 Identities=19% Similarity=0.230 Sum_probs=130.0
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc--eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK--ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk--~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
.|..+.|||+|+++++++.|++|++|+..+++ ..+++ .||...|+.++|+|||+.+++|+.|+|||+|
T Consensus 161 sv~~~~fs~~g~~l~~~~~~~~i~~~~~~~~~~~~~~~l----------~~h~~~v~~~~fs~d~~~l~s~s~D~tiriw 230 (456)
T KOG0266|consen 161 SVTCVDFSPDGRALAAASSDGLIRIWKLEGIKSNLLREL----------SGHTRGVSDVAFSPDGSYLLSGSDDKTLRIW 230 (456)
T ss_pred ceEEEEEcCCCCeEEEccCCCcEEEeecccccchhhccc----------cccccceeeeEECCCCcEEEEecCCceEEEe
Confidence 45789999999999999999999999997777 33333 3677999999999999999999999999999
Q ss_pred eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080 2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
|++..+ +.++++.||+..|++++|+| +|++|+|| +.|+||||||+ .+++++..|.+|.++|++++++++|
T Consensus 231 d~~~~~----~~~~~l~gH~~~v~~~~f~p-~g~~i~Sg---s~D~tvriWd~--~~~~~~~~l~~hs~~is~~~f~~d~ 300 (456)
T KOG0266|consen 231 DLKDDG----RNLKTLKGHSTYVTSVAFSP-DGNLLVSG---SDDGTVRIWDV--RTGECVRKLKGHSDGISGLAFSPDG 300 (456)
T ss_pred eccCCC----eEEEEecCCCCceEEEEecC-CCCEEEEe---cCCCcEEEEec--cCCeEEEeeeccCCceEEEEECCCC
Confidence 995543 57899999999999999999 88999996 69999999998 5689999999999999999999999
Q ss_pred hhhhccc
Q 000080 2379 NFALSKC 2385 (2389)
Q Consensus 2379 ~~~~s~~ 2385 (2389)
+..++-+
T Consensus 301 ~~l~s~s 307 (456)
T KOG0266|consen 301 NLLVSAS 307 (456)
T ss_pred CEEEEcC
Confidence 9988765
No 19
>KOG0292 consensus Vesicle coat complex COPI, alpha subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.75 E-value=5e-18 Score=212.24 Aligned_cols=176 Identities=17% Similarity=0.173 Sum_probs=145.1
Q ss_pred cccceeeccccccccccccc------cCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC
Q 000080 2192 AGIGASALGWETQDDFEDYV------DPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV 2265 (2389)
Q Consensus 2192 ~~~~Asg~~~d~~~~~~~~~------d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~ 2265 (2389)
..+-.|| |.|-.+++|.|. ....++++| |++.||+.-|+|+|+|+|.|||||+|.+++|+.+++
T Consensus 63 qplFVSG-GDDykIkVWnYk~rrclftL~GHlDYV--Rt~~FHheyPWIlSASDDQTIrIWNwqsr~~iavlt------- 132 (1202)
T KOG0292|consen 63 QPLFVSG-GDDYKIKVWNYKTRRCLFTLLGHLDYV--RTVFFHHEYPWILSASDDQTIRIWNWQSRKCIAVLT------- 132 (1202)
T ss_pred CCeEEec-CCccEEEEEecccceehhhhcccccee--EEeeccCCCceEEEccCCCeEEEEeccCCceEEEEe-------
Confidence 3566888 999999999885 233445554 999999999999999999999999999999999985
Q ss_pred CCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCccc------------------------ceeeeecCCCe
Q 000080 2266 PPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRP------------------------MESCLCFSSHA 2321 (2389)
Q Consensus 2266 p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~------------------------l~tl~gHs~~V 2321 (2389)
||.++|+|-+|.|.-..++|||.|.|||+||+.--.+.+..| -.-+.||...|
T Consensus 133 ---GHnHYVMcAqFhptEDlIVSaSLDQTVRVWDisGLRkk~~~pg~~e~~~~~~~~~~dLfg~~DaVVK~VLEGHDRGV 209 (1202)
T KOG0292|consen 133 ---GHNHYVMCAQFHPTEDLIVSASLDQTVRVWDISGLRKKNKAPGSLEDQMRGQQGNSDLFGQTDAVVKHVLEGHDRGV 209 (1202)
T ss_pred ---cCceEEEeeccCCccceEEEecccceEEEEeecchhccCCCCCCchhhhhccccchhhcCCcCeeeeeeeccccccc
Confidence 577999999999999999999999999999995311000000 13478999999
Q ss_pred eEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080 2322 MDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2322 ~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
+-+||+| .-.+|+|| ++|+.||||.+.....=.+-+..||.|.|.|+-++|.-+-+||.
T Consensus 210 NwaAfhp-TlpliVSG---~DDRqVKlWrmnetKaWEvDtcrgH~nnVssvlfhp~q~lIlSn 268 (1202)
T KOG0292|consen 210 NWAAFHP-TLPLIVSG---ADDRQVKLWRMNETKAWEVDTCRGHYNNVSSVLFHPHQDLILSN 268 (1202)
T ss_pred ceEEecC-CcceEEec---CCcceeeEEEeccccceeehhhhcccCCcceEEecCccceeEec
Confidence 9999999 88899986 59999999999533222277889999999999999999988885
No 20
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=99.75 E-value=1e-17 Score=191.91 Aligned_cols=162 Identities=15% Similarity=0.172 Sum_probs=128.6
Q ss_pred eccccccccccccccCCCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEE
Q 000080 2198 ALGWETQDDFEDYVDPPATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASIS 2275 (2389)
Q Consensus 2198 g~~~d~~~~~~~~~d~~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~ 2275 (2389)
.+.|+-+-+-+.|-.+.+.+.+ =.|..++.++||++.+|||.|+++|+||+.+|+..+.|. ||...|.
T Consensus 40 ii~W~L~~dd~~~G~~~r~~~GHsH~v~dv~~s~dg~~alS~swD~~lrlWDl~~g~~t~~f~----------GH~~dVl 109 (315)
T KOG0279|consen 40 IIVWKLTSDDIKYGVPVRRLTGHSHFVSDVVLSSDGNFALSASWDGTLRLWDLATGESTRRFV----------GHTKDVL 109 (315)
T ss_pred EEEEEeccCccccCceeeeeeccceEecceEEccCCceEEeccccceEEEEEecCCcEEEEEE----------ecCCceE
Confidence 3445555444444333333322 245788999999999999999999999999998888774 5778999
Q ss_pred EEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeee--cCCCeeEEEEecCC-CCEEEEeecCCCCCeEEEeeCC
Q 000080 2276 ALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLC--FSSHAMDVSYITSS-GSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2276 sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~g--Hs~~V~sVAFSP~D-GslLASAG~sS~D~TVrLWD~l 2352 (2389)
+|+||||.+.+.|||.|+||+|||+-.+ +..+... |...|++|.|+|.. ..+|+++ |.|+|||+||+
T Consensus 110 sva~s~dn~qivSGSrDkTiklwnt~g~------ck~t~~~~~~~~WVscvrfsP~~~~p~Ivs~---s~DktvKvWnl- 179 (315)
T KOG0279|consen 110 SVAFSTDNRQIVSGSRDKTIKLWNTLGV------CKYTIHEDSHREWVSCVRFSPNESNPIIVSA---SWDKTVKVWNL- 179 (315)
T ss_pred EEEecCCCceeecCCCcceeeeeeeccc------EEEEEecCCCcCcEEEEEEcCCCCCcEEEEc---cCCceEEEEcc-
Confidence 9999999999999999999999999753 3344433 37899999999952 5788887 59999999998
Q ss_pred CCCCCceEEEEeecCcEEEEeecccchh
Q 000080 2353 APPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus 2353 ~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
.+-+..+.+.||++-++.++.||||--
T Consensus 180 -~~~~l~~~~~gh~~~v~t~~vSpDGsl 206 (315)
T KOG0279|consen 180 -RNCQLRTTFIGHSGYVNTVTVSPDGSL 206 (315)
T ss_pred -CCcchhhccccccccEEEEEECCCCCE
Confidence 344457899999999999999999953
No 21
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.74 E-value=1.5e-17 Score=206.39 Aligned_cols=146 Identities=16% Similarity=0.227 Sum_probs=125.8
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
.++.+++++|||+++|||++||.||+||..+|-|+.||. -|++.|++|+|+..|+.+.|+|.|||||.||
T Consensus 351 ~~i~~l~YSpDgq~iaTG~eDgKVKvWn~~SgfC~vTFt----------eHts~Vt~v~f~~~g~~llssSLDGtVRAwD 420 (893)
T KOG0291|consen 351 DRITSLAYSPDGQLIATGAEDGKVKVWNTQSGFCFVTFT----------EHTSGVTAVQFTARGNVLLSSSLDGTVRAWD 420 (893)
T ss_pred cceeeEEECCCCcEEEeccCCCcEEEEeccCceEEEEec----------cCCCceEEEEEEecCCEEEEeecCCeEEeee
Confidence 355899999999999999999999999999999999995 2679999999999999999999999999999
Q ss_pred CCCCCc---------------------------------------cCcccceeeeecCCCeeEEEEecCCCCEEEEeecC
Q 000080 2300 LEVGGR---------------------------------------SNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHS 2340 (2389)
Q Consensus 2300 l~tggr---------------------------------------s~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~s 2340 (2389)
+..... +.-+.+..+.||+++|.+++|+| +|+.|||+
T Consensus 421 lkRYrNfRTft~P~p~QfscvavD~sGelV~AG~~d~F~IfvWS~qTGqllDiLsGHEgPVs~l~f~~-~~~~LaS~--- 496 (893)
T KOG0291|consen 421 LKRYRNFRTFTSPEPIQFSCVAVDPSGELVCAGAQDSFEIFVWSVQTGQLLDILSGHEGPVSGLSFSP-DGSLLASG--- 496 (893)
T ss_pred ecccceeeeecCCCceeeeEEEEcCCCCEEEeeccceEEEEEEEeecCeeeehhcCCCCcceeeEEcc-ccCeEEec---
Confidence 976521 11134556789999999999999 99999996
Q ss_pred CCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhh
Q 000080 2341 SNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFA 2381 (2389)
Q Consensus 2341 S~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~ 2381 (2389)
|.|+|||+||+.. ....+-+|+ +...|..|+++|+|+.+
T Consensus 497 SWDkTVRiW~if~-s~~~vEtl~-i~sdvl~vsfrPdG~el 535 (893)
T KOG0291|consen 497 SWDKTVRIWDIFS-SSGTVETLE-IRSDVLAVSFRPDGKEL 535 (893)
T ss_pred cccceEEEEEeec-cCceeeeEe-eccceeEEEEcCCCCeE
Confidence 7999999999974 334567777 88889999999999753
No 22
>PTZ00421 coronin; Provisional
Probab=99.72 E-value=9.7e-17 Score=201.63 Aligned_cols=142 Identities=17% Similarity=0.253 Sum_probs=119.8
Q ss_pred eEEEEEEcC-CCCeEEEEeCCCcEEEeecCCCc-------eeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeC
Q 000080 2221 STRAFSSHP-LRPFFLVGSSNTHIYLWEFGKDK-------ATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAAL 2291 (2389)
Q Consensus 2221 ~VrsVAFsP-dG~~LASGS~DgTIRLWDl~tGk-------~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~ 2291 (2389)
.|.+|+|+| ++++|||||.|++|++||+.++. .+.++ .||...|.+|+|+|++ +.||||+.
T Consensus 77 ~V~~v~fsP~d~~~LaSgS~DgtIkIWdi~~~~~~~~~~~~l~~L----------~gH~~~V~~l~f~P~~~~iLaSgs~ 146 (493)
T PTZ00421 77 PIIDVAFNPFDPQKLFTASEDGTIMGWGIPEEGLTQNISDPIVHL----------QGHTKKVGIVSFHPSAMNVLASAGA 146 (493)
T ss_pred CEEEEEEcCCCCCEEEEEeCCCEEEEEecCCCccccccCcceEEe----------cCCCCcEEEEEeCcCCCCEEEEEeC
Confidence 469999999 89999999999999999997653 23444 2577899999999986 79999999
Q ss_pred CCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcE-E
Q 000080 2292 DGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLY-D 2370 (2389)
Q Consensus 2292 DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V-~ 2370 (2389)
|++|+|||++++ +....+.+|...|.+++|+| +|++|||+ +.|++|+|||+ .+++.+.++.+|.+.+ .
T Consensus 147 DgtVrIWDl~tg-----~~~~~l~~h~~~V~sla~sp-dG~lLatg---s~Dg~IrIwD~--rsg~~v~tl~~H~~~~~~ 215 (493)
T PTZ00421 147 DMVVNVWDVERG-----KAVEVIKCHSDQITSLEWNL-DGSLLCTT---SKDKKLNIIDP--RDGTIVSSVEAHASAKSQ 215 (493)
T ss_pred CCEEEEEECCCC-----eEEEEEcCCCCceEEEEEEC-CCCEEEEe---cCCCEEEEEEC--CCCcEEEEEecCCCCcce
Confidence 999999999986 46678889999999999999 99999996 58999999998 4677789999998754 3
Q ss_pred EEeecccchhhhc
Q 000080 2371 LFLPLKLLNFALS 2383 (2389)
Q Consensus 2371 svA~~~~~~~~~s 2383 (2389)
.+...++++.+++
T Consensus 216 ~~~w~~~~~~ivt 228 (493)
T PTZ00421 216 RCLWAKRKDLIIT 228 (493)
T ss_pred EEEEcCCCCeEEE
Confidence 5666677666653
No 23
>KOG0273 consensus Beta-transducin family (WD-40 repeat) protein [Chromatin structure and dynamics]
Probab=99.71 E-value=1.1e-16 Score=192.24 Aligned_cols=195 Identities=15% Similarity=0.196 Sum_probs=155.5
Q ss_pred CCCccccCccccccccccccceeeccccccccccccc-cCCCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCC
Q 000080 2175 RPGRDLTGGLAFGIPGYAGIGASALGWETQDDFEDYV-DPPATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKD 2251 (2389)
Q Consensus 2175 ~~~~~~~~~~~~~~~g~~~~~Asg~~~d~~~~~~~~~-d~~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tG 2251 (2389)
.+-|+.| +.+| .+.+..+|.| .++...|+|.-. ....++.. .+|.++.|+-.|.+|+||+-|+|+-|||.-+|
T Consensus 233 ~~nkdVT-~L~W--n~~G~~LatG-~~~G~~riw~~~G~l~~tl~~HkgPI~slKWnk~G~yilS~~vD~ttilwd~~~g 308 (524)
T KOG0273|consen 233 PSNKDVT-SLDW--NNDGTLLATG-SEDGEARIWNKDGNLISTLGQHKGPIFSLKWNKKGTYILSGGVDGTTILWDAHTG 308 (524)
T ss_pred CccCCcc-eEEe--cCCCCeEEEe-ecCcEEEEEecCchhhhhhhccCCceEEEEEcCCCCEEEeccCCccEEEEeccCc
Confidence 3445554 2445 4566789999 899999999764 22233332 58899999999999999999999999999888
Q ss_pred ceeeEec--ccCCCC--------------------------CC---CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2252 KATATYG--VLPAAN--------------------------VP---PPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2252 k~l~Tl~--vl~gh~--------------------------~p---~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
+..+-|. ..|+-. -| ..||.+.|.++.|+|.|..|||+|.|+|+|||..
T Consensus 309 ~~~q~f~~~s~~~lDVdW~~~~~F~ts~td~~i~V~kv~~~~P~~t~~GH~g~V~alk~n~tg~LLaS~SdD~TlkiWs~ 388 (524)
T KOG0273|consen 309 TVKQQFEFHSAPALDVDWQSNDEFATSSTDGCIHVCKVGEDRPVKTFIGHHGEVNALKWNPTGSLLASCSDDGTLKIWSM 388 (524)
T ss_pred eEEEeeeeccCCccceEEecCceEeecCCCceEEEEEecCCCcceeeecccCceEEEEECCCCceEEEecCCCeeEeeec
Confidence 7654442 111000 01 5689999999999999999999999999999998
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecC--------CCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEE
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITS--------SGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLF 2372 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~--------DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~sv 2372 (2389)
..+ .....+++|+..|+.+.++|. +|..||++ +.|+||++||+ ..+.++++|+.|+.+|.+|
T Consensus 389 ~~~-----~~~~~l~~Hskei~t~~wsp~g~v~~n~~~~~~l~sa---s~dstV~lwdv--~~gv~i~~f~kH~~pVysv 458 (524)
T KOG0273|consen 389 GQS-----NSVHDLQAHSKEIYTIKWSPTGPVTSNPNMNLMLASA---SFDSTVKLWDV--ESGVPIHTLMKHQEPVYSV 458 (524)
T ss_pred CCC-----cchhhhhhhccceeeEeecCCCCccCCCcCCceEEEe---ecCCeEEEEEc--cCCceeEeeccCCCceEEE
Confidence 765 356778899999999999983 34588887 48999999998 4678999999999999999
Q ss_pred eecccchhhhc
Q 000080 2373 LPLKLLNFALS 2383 (2389)
Q Consensus 2373 A~~~~~~~~~s 2383 (2389)
|++|+|++..|
T Consensus 459 afS~~g~ylAs 469 (524)
T KOG0273|consen 459 AFSPNGRYLAS 469 (524)
T ss_pred EecCCCcEEEe
Confidence 99999999865
No 24
>KOG0292 consensus Vesicle coat complex COPI, alpha subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.70 E-value=5.5e-17 Score=203.11 Aligned_cols=162 Identities=19% Similarity=0.255 Sum_probs=136.2
Q ss_pred ccccccccccCCCCc-----CceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEE
Q 000080 2203 TQDDFEDYVDPPATV-----ENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISAL 2277 (2389)
Q Consensus 2203 ~~~~~~~~~d~~atv-----~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sV 2277 (2389)
..+++|+|.=. .-+ +..+||.|+|||++++++||++|.+||+|+..+-+|+-|+ .||.++|+.+
T Consensus 31 G~IQlWDYRM~-tli~rFdeHdGpVRgv~FH~~qplFVSGGDDykIkVWnYk~rrclftL----------~GHlDYVRt~ 99 (1202)
T KOG0292|consen 31 GVIQLWDYRMG-TLIDRFDEHDGPVRGVDFHPTQPLFVSGGDDYKIKVWNYKTRRCLFTL----------LGHLDYVRTV 99 (1202)
T ss_pred ceeeeehhhhh-hHHhhhhccCCccceeeecCCCCeEEecCCccEEEEEecccceehhhh----------ccccceeEEe
Confidence 45677777410 001 1246799999999999999999999999999999998887 3788999999
Q ss_pred EECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC-----
Q 000080 2278 QFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL----- 2352 (2389)
Q Consensus 2278 aFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l----- 2352 (2389)
.|.+.=-++.|||+|.|||+||-.++ +++..++||+..|.+..|+| ...+|+|| |-|.|||+||+-
T Consensus 100 ~FHheyPWIlSASDDQTIrIWNwqsr-----~~iavltGHnHYVMcAqFhp-tEDlIVSa---SLDQTVRVWDisGLRkk 170 (1202)
T KOG0292|consen 100 FFHHEYPWILSASDDQTIRIWNWQSR-----KCIAVLTGHNHYVMCAQFHP-TEDLIVSA---SLDQTVRVWDISGLRKK 170 (1202)
T ss_pred eccCCCceEEEccCCCeEEEEeccCC-----ceEEEEecCceEEEeeccCC-ccceEEEe---cccceEEEEeecchhcc
Confidence 99999999999999999999999885 58899999999999999999 88999997 699999999971
Q ss_pred -CCCC-------------------Cce--EEEEeecCcEEEEeecccchhhhcc
Q 000080 2353 -APPT-------------------SSR--ASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2353 -~~tg-------------------~~v--~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
.+++ .++ +.|+||+-+|+-.|++|-+--+||-
T Consensus 171 ~~~pg~~e~~~~~~~~~~dLfg~~DaVVK~VLEGHDRGVNwaAfhpTlpliVSG 224 (1202)
T KOG0292|consen 171 NKAPGSLEDQMRGQQGNSDLFGQTDAVVKHVLEGHDRGVNWAAFHPTLPLIVSG 224 (1202)
T ss_pred CCCCCCchhhhhccccchhhcCCcCeeeeeeecccccccceEEecCCcceEEec
Confidence 1222 343 5689999999999999977777763
No 25
>KOG0295 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.68 E-value=2.3e-16 Score=185.34 Aligned_cols=167 Identities=13% Similarity=0.189 Sum_probs=143.3
Q ss_pred ccceeeccccccccccccc------cCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCC
Q 000080 2193 GIGASALGWETQDDFEDYV------DPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVP 2266 (2389)
Q Consensus 2193 ~~~Asg~~~d~~~~~~~~~------d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p 2266 (2389)
+-.+|- ++|.+++.|++. ..+++.+ -||-|+.+.||.++||+|.|.||++|=+++++|...++ +
T Consensus 206 d~ilS~-srD~tik~We~~tg~cv~t~~~h~e--wvr~v~v~~DGti~As~s~dqtl~vW~~~t~~~k~~lR---~---- 275 (406)
T KOG0295|consen 206 DHILSC-SRDNTIKAWECDTGYCVKTFPGHSE--WVRMVRVNQDGTIIASCSNDQTLRVWVVATKQCKAELR---E---- 275 (406)
T ss_pred Ceeeec-ccccceeEEecccceeEEeccCchH--hEEEEEecCCeeEEEecCCCceEEEEEeccchhhhhhh---c----
Confidence 666777 889999999873 2222233 46999999999999999999999999999999988775 3
Q ss_pred CCCCCCCEEEEEECCC---------------CCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCC
Q 000080 2267 PPYALASISALQFDHY---------------GHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSG 2331 (2389)
Q Consensus 2267 ~~GH~~~V~sVaFSPD---------------G~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DG 2331 (2389)
|...|-+|+|-|. |+.++++|.|+|||+||+.+| .++.++.||..+|++++|+| .|
T Consensus 276 ---hEh~vEci~wap~~~~~~i~~at~~~~~~~~l~s~SrDktIk~wdv~tg-----~cL~tL~ghdnwVr~~af~p-~G 346 (406)
T KOG0295|consen 276 ---HEHPVECIAWAPESSYPSISEATGSTNGGQVLGSGSRDKTIKIWDVSTG-----MCLFTLVGHDNWVRGVAFSP-GG 346 (406)
T ss_pred ---cccceEEEEecccccCcchhhccCCCCCccEEEeecccceEEEEeccCC-----eEEEEEecccceeeeeEEcC-CC
Confidence 5566888887652 369999999999999999997 58999999999999999999 99
Q ss_pred CEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080 2332 SVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2332 slLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
++|+|. ++|+|+|+||+ .+.+|.+.+..|+.-|+++++++.-.+.++
T Consensus 347 kyi~Sc---aDDktlrvwdl--~~~~cmk~~~ah~hfvt~lDfh~~~p~VvT 393 (406)
T KOG0295|consen 347 KYILSC---ADDKTLRVWDL--KNLQCMKTLEAHEHFVTSLDFHKTAPYVVT 393 (406)
T ss_pred eEEEEE---ecCCcEEEEEe--ccceeeeccCCCcceeEEEecCCCCceEEe
Confidence 999996 69999999998 578999999999999999999987665544
No 26
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=99.67 E-value=5.1e-16 Score=175.92 Aligned_cols=180 Identities=16% Similarity=0.193 Sum_probs=138.1
Q ss_pred ccccccccccceeeccccccccccccc----cCCCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEec
Q 000080 2185 AFGIPGYAGIGASALGWETQDDFEDYV----DPPATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYG 2258 (2389)
Q Consensus 2185 ~~~~~g~~~~~Asg~~~d~~~~~~~~~----d~~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~ 2258 (2389)
+..||-..+++|.+ +|... |+-+.. .|+++.+. --|.+|.|+-||++.+|||+||++||||++...|-+.|+
T Consensus 45 rLeiTpdk~~LAaa-~~qhv-RlyD~~S~np~Pv~t~e~h~kNVtaVgF~~dgrWMyTgseDgt~kIWdlR~~~~qR~~~ 122 (311)
T KOG0315|consen 45 RLEITPDKKDLAAA-GNQHV-RLYDLNSNNPNPVATFEGHTKNVTAVGFQCDGRWMYTGSEDGTVKIWDLRSLSCQRNYQ 122 (311)
T ss_pred eEEEcCCcchhhhc-cCCee-EEEEccCCCCCceeEEeccCCceEEEEEeecCeEEEecCCCceEEEEeccCcccchhcc
Confidence 45566677777777 66544 444442 35566442 235999999999999999999999999999877777774
Q ss_pred ccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCC----------------------------------
Q 000080 2259 VLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGG---------------------------------- 2304 (2389)
Q Consensus 2259 vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tgg---------------------------------- 2304 (2389)
|.+.|++|..+|+..-|.+|..+|.|++||+....
T Consensus 123 -----------~~spVn~vvlhpnQteLis~dqsg~irvWDl~~~~c~~~liPe~~~~i~sl~v~~dgsml~a~nnkG~c 191 (311)
T KOG0315|consen 123 -----------HNSPVNTVVLHPNQTELISGDQSGNIRVWDLGENSCTHELIPEDDTSIQSLTVMPDGSMLAAANNKGNC 191 (311)
T ss_pred -----------CCCCcceEEecCCcceEEeecCCCcEEEEEccCCccccccCCCCCcceeeEEEcCCCcEEEEecCCccE
Confidence 23557777777777777777777777777765420
Q ss_pred ----------ccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCC-CceEEEEeecCcEEEEe
Q 000080 2305 ----------RSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPT-SSRASITCHEGLYDLFL 2373 (2389)
Q Consensus 2305 ----------rs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg-~~v~sL~GH~~~V~svA 2373 (2389)
.+.+.|+..++.|++++....||| |+++|||+ |.|+||+||++. +- +.-..++||+.+++..+
T Consensus 192 yvW~l~~~~~~s~l~P~~k~~ah~~~il~C~lSP-d~k~lat~---ssdktv~iwn~~--~~~kle~~l~gh~rWvWdc~ 265 (311)
T KOG0315|consen 192 YVWRLLNHQTASELEPVHKFQAHNGHILRCLLSP-DVKYLATC---SSDKTVKIWNTD--DFFKLELVLTGHQRWVWDCA 265 (311)
T ss_pred EEEEccCCCccccceEhhheecccceEEEEEECC-CCcEEEee---cCCceEEEEecC--CceeeEEEeecCCceEEeee
Confidence 034567788899999999999999 99999997 589999999972 22 34578999999999999
Q ss_pred ecccchhhhc
Q 000080 2374 PLKLLNFALS 2383 (2389)
Q Consensus 2374 ~~~~~~~~~s 2383 (2389)
||-+|.+++.
T Consensus 266 FS~dg~YlvT 275 (311)
T KOG0315|consen 266 FSADGEYLVT 275 (311)
T ss_pred eccCccEEEe
Confidence 9999999875
No 27
>KOG0285 consensus Pleiotropic regulator 1 [RNA processing and modification]
Probab=99.66 E-value=3.8e-16 Score=182.74 Aligned_cols=136 Identities=16% Similarity=0.239 Sum_probs=124.9
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
..||+|++.|..++++|||.|+||+|||+.+|++..|+ +||...|+.|+||+---++.|+++|+.||-||
T Consensus 152 gWVr~vavdP~n~wf~tgs~DrtikIwDlatg~Lkltl----------tGhi~~vr~vavS~rHpYlFs~gedk~VKCwD 221 (460)
T KOG0285|consen 152 GWVRSVAVDPGNEWFATGSADRTIKIWDLATGQLKLTL----------TGHIETVRGVAVSKRHPYLFSAGEDKQVKCWD 221 (460)
T ss_pred ceEEEEeeCCCceeEEecCCCceeEEEEcccCeEEEee----------cchhheeeeeeecccCceEEEecCCCeeEEEe
Confidence 46799999999999999999999999999999998887 36889999999999999999999999999999
Q ss_pred CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
++.. +.++.+-||-..|++++.+| .-.+|+|+ +.|.++||||+ .+...+..|.||++.|.+|...|
T Consensus 222 Le~n-----kvIR~YhGHlS~V~~L~lhP-Tldvl~t~---grDst~RvWDi--Rtr~~V~~l~GH~~~V~~V~~~~ 287 (460)
T KOG0285|consen 222 LEYN-----KVIRHYHGHLSGVYCLDLHP-TLDVLVTG---GRDSTIRVWDI--RTRASVHVLSGHTNPVASVMCQP 287 (460)
T ss_pred chhh-----hhHHHhccccceeEEEeccc-cceeEEec---CCcceEEEeee--cccceEEEecCCCCcceeEEeec
Confidence 9974 67888999999999999999 77999997 48999999998 46777999999999999988764
No 28
>PTZ00421 coronin; Provisional
Probab=99.65 E-value=2.3e-15 Score=189.44 Aligned_cols=173 Identities=13% Similarity=0.124 Sum_probs=132.2
Q ss_pred cccceeeccccccccccccccC---------CCCcC--ceeEEEEEEcCCC-CeEEEEeCCCcEEEeecCCCceeeEecc
Q 000080 2192 AGIGASALGWETQDDFEDYVDP---------PATVE--NISTRAFSSHPLR-PFFLVGSSNTHIYLWEFGKDKATATYGV 2259 (2389)
Q Consensus 2192 ~~~~Asg~~~d~~~~~~~~~d~---------~atv~--ni~VrsVAFsPdG-~~LASGS~DgTIRLWDl~tGk~l~Tl~v 2259 (2389)
+..+|++ ++|.+.++|+..+. ..++. .-.|.+|+|||++ ++|+|||.|++|+|||+.+++.+.++.
T Consensus 88 ~~~LaSg-S~DgtIkIWdi~~~~~~~~~~~~l~~L~gH~~~V~~l~f~P~~~~iLaSgs~DgtVrIWDl~tg~~~~~l~- 165 (493)
T PTZ00421 88 PQKLFTA-SEDGTIMGWGIPEEGLTQNISDPIVHLQGHTKKVGIVSFHPSAMNVLASAGADMVVNVWDVERGKAVEVIK- 165 (493)
T ss_pred CCEEEEE-eCCCEEEEEecCCCccccccCcceEEecCCCCcEEEEEeCcCCCCEEEEEeCCCEEEEEECCCCeEEEEEc-
Confidence 3468888 88999999987432 11221 2367999999986 699999999999999999999887773
Q ss_pred cCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCe-eEEEEecCCCCEEEEee
Q 000080 2260 LPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHA-MDVSYITSSGSVIAAAG 2338 (2389)
Q Consensus 2260 l~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V-~sVAFSP~DGslLASAG 2338 (2389)
+|.+.|++|+|+|||+.||+|+.|++|++||++++ +.+.++.+|.+.+ ..+.|.+ ++..|+++|
T Consensus 166 ---------~h~~~V~sla~spdG~lLatgs~Dg~IrIwD~rsg-----~~v~tl~~H~~~~~~~~~w~~-~~~~ivt~G 230 (493)
T PTZ00421 166 ---------CHSDQITSLEWNLDGSLLCTTSKDKKLNIIDPRDG-----TIVSSVEAHASAKSQRCLWAK-RKDLIITLG 230 (493)
T ss_pred ---------CCCCceEEEEEECCCCEEEEecCCCEEEEEECCCC-----cEEEEEecCCCCcceEEEEcC-CCCeEEEEe
Confidence 46688999999999999999999999999999986 4567788898654 4678888 667777776
Q ss_pred cC-CCCCeEEEeeCCCCCCCceEEEEeec-CcEEEEeecccchhhh
Q 000080 2339 HS-SNGINVVVWDTLAPPTSSRASITCHE-GLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus 2339 ~s-S~D~TVrLWD~l~~tg~~v~sL~GH~-~~V~svA~~~~~~~~~ 2382 (2389)
++ +.|++|+|||+.. ....+.....|. ..+....++++++..+
T Consensus 231 ~s~s~Dr~VklWDlr~-~~~p~~~~~~d~~~~~~~~~~d~d~~~L~ 275 (493)
T PTZ00421 231 CSKSQQRQIMLWDTRK-MASPYSTVDLDQSSALFIPFFDEDTNLLY 275 (493)
T ss_pred cCCCCCCeEEEEeCCC-CCCceeEeccCCCCceEEEEEcCCCCEEE
Confidence 53 4689999999842 223455554443 4455667788887654
No 29
>PTZ00420 coronin; Provisional
Probab=99.65 E-value=1.7e-15 Score=192.46 Aligned_cols=149 Identities=16% Similarity=0.193 Sum_probs=114.7
Q ss_pred eEEEEEEcCC-CCeEEEEeCCCcEEEeecCCCce-eeEecccCCCCCCCCCCCCCEEEEEECCCCCE-EEEEeCCCcEEE
Q 000080 2221 STRAFSSHPL-RPFFLVGSSNTHIYLWEFGKDKA-TATYGVLPAANVPPPYALASISALQFDHYGHR-FASAALDGTVCT 2297 (2389)
Q Consensus 2221 ~VrsVAFsPd-G~~LASGS~DgTIRLWDl~tGk~-l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~-LASgS~DgTVkL 2297 (2389)
.|.+|+|||+ +.+|||||.|++|+|||+.++.. +.++.. +-. ...||...|.+|+|+|+|.. ||||+.|++|+|
T Consensus 76 ~V~~lafsP~~~~lLASgS~DgtIrIWDi~t~~~~~~~i~~-p~~--~L~gH~~~V~sVaf~P~g~~iLaSgS~DgtIrI 152 (568)
T PTZ00420 76 SILDLQFNPCFSEILASGSEDLTIRVWEIPHNDESVKEIKD-PQC--ILKGHKKKISIIDWNPMNYYIMCSSGFDSFVNI 152 (568)
T ss_pred CEEEEEEcCCCCCEEEEEeCCCeEEEEECCCCCcccccccc-ceE--EeecCCCcEEEEEECCCCCeEEEEEeCCCeEEE
Confidence 4699999997 78999999999999999976532 111100 000 01357789999999999975 689999999999
Q ss_pred eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEE-----E
Q 000080 2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDL-----F 2372 (2389)
Q Consensus 2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~s-----v 2372 (2389)
||++++. ....+. |...|.+++|+| +|++||++ +.|++|+|||+ .+++.++++.+|.+.+.+ .
T Consensus 153 WDl~tg~-----~~~~i~-~~~~V~Slswsp-dG~lLat~---s~D~~IrIwD~--Rsg~~i~tl~gH~g~~~s~~v~~~ 220 (568)
T PTZ00420 153 WDIENEK-----RAFQIN-MPKKLSSLKWNI-KGNLLSGT---CVGKHMHIIDP--RKQEIASSFHIHDGGKNTKNIWID 220 (568)
T ss_pred EECCCCc-----EEEEEe-cCCcEEEEEECC-CCCEEEEE---ecCCEEEEEEC--CCCcEEEEEecccCCceeEEEEee
Confidence 9999862 344444 667899999999 99999986 48999999998 467778999999987543 2
Q ss_pred eecccchhhhcc
Q 000080 2373 LPLKLLNFALSK 2384 (2389)
Q Consensus 2373 A~~~~~~~~~s~ 2384 (2389)
.++++++++++-
T Consensus 221 ~fs~d~~~IlTt 232 (568)
T PTZ00420 221 GLGGDDNYILST 232 (568)
T ss_pred eEcCCCCEEEEE
Confidence 345788887763
No 30
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=99.65 E-value=8e-16 Score=177.25 Aligned_cols=142 Identities=15% Similarity=0.178 Sum_probs=123.0
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECC-CCCEEEEEeCCCcEEEe
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDH-YGHRFASAALDGTVCTW 2298 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSP-DG~~LASgS~DgTVkLW 2298 (2389)
.++.++.|-+|+ .|+|||.|+|.-|||+++|+.+..|. ||.+.|.++.++| ++++|+||+.|++.+||
T Consensus 146 gylScC~f~dD~-~ilT~SGD~TCalWDie~g~~~~~f~----------GH~gDV~slsl~p~~~ntFvSg~cD~~aklW 214 (343)
T KOG0286|consen 146 GYLSCCRFLDDN-HILTGSGDMTCALWDIETGQQTQVFH----------GHTGDVMSLSLSPSDGNTFVSGGCDKSAKLW 214 (343)
T ss_pred ceeEEEEEcCCC-ceEecCCCceEEEEEcccceEEEEec----------CCcccEEEEecCCCCCCeEEecccccceeee
Confidence 355888998855 57789999999999999999999883 6889999999999 99999999999999999
Q ss_pred eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE--eecCcEEEEeecc
Q 000080 2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT--CHEGLYDLFLPLK 2376 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~--GH~~~V~svA~~~ 2376 (2389)
|++.+ .+.+++.||+..|++|+|.| +|.-+||| |+|+|.|++|+. ..+.+..++ .--.+|++|++|+
T Consensus 215 D~R~~-----~c~qtF~ghesDINsv~ffP-~G~afatG---SDD~tcRlyDlR--aD~~~a~ys~~~~~~gitSv~FS~ 283 (343)
T KOG0286|consen 215 DVRSG-----QCVQTFEGHESDINSVRFFP-SGDAFATG---SDDATCRLYDLR--ADQELAVYSHDSIICGITSVAFSK 283 (343)
T ss_pred eccCc-----ceeEeecccccccceEEEcc-CCCeeeec---CCCceeEEEeec--CCcEEeeeccCcccCCceeEEEcc
Confidence 99987 47899999999999999999 99999995 799999999985 344555555 2336788999999
Q ss_pred cchhhhc
Q 000080 2377 LLNFALS 2383 (2389)
Q Consensus 2377 ~~~~~~s 2383 (2389)
+||..+.
T Consensus 284 SGRlLfa 290 (343)
T KOG0286|consen 284 SGRLLFA 290 (343)
T ss_pred cccEEEe
Confidence 9986553
No 31
>KOG0319 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.65 E-value=4.4e-16 Score=193.94 Aligned_cols=180 Identities=18% Similarity=0.148 Sum_probs=144.1
Q ss_pred ccceeeccccccccccccccC------CCC--cCceeEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCC
Q 000080 2193 GIGASALGWETQDDFEDYVDP------PAT--VENISTRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAA 2263 (2389)
Q Consensus 2193 ~~~Asg~~~d~~~~~~~~~d~------~at--v~ni~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh 2263 (2389)
+.+|+| +-|...++|.+.+. .+. -++..|-+|+++-.|. +|+|+|.|+|||+|++...+.......+..-
T Consensus 378 ~llat~-sKD~svilWr~~~~~~~~~~~a~~~gH~~svgava~~~~~asffvsvS~D~tlK~W~l~~s~~~~~~~~~~~~ 456 (775)
T KOG0319|consen 378 DLLATG-SKDKSVILWRLNNNCSKSLCVAQANGHTNSVGAVAGSKLGASFFVSVSQDCTLKLWDLPKSKETAFPIVLTCR 456 (775)
T ss_pred cEEEEe-cCCceEEEEEecCCcchhhhhhhhcccccccceeeecccCccEEEEecCCceEEEecCCCcccccccceehhh
Confidence 578888 89999999977321 111 1224668899987766 8999999999999999763321110000000
Q ss_pred CCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCC
Q 000080 2264 NVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNG 2343 (2389)
Q Consensus 2264 ~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D 2343 (2389)
.....|...|++|+++|+.+.|||||.|+|.|||+++.. ....++.||...|++|.|+| ..+++||+ |.|
T Consensus 457 -~t~~aHdKdIN~Vaia~ndkLiAT~SqDktaKiW~le~~-----~l~~vLsGH~RGvw~V~Fs~-~dq~laT~---SgD 526 (775)
T KOG0319|consen 457 -YTERAHDKDINCVAIAPNDKLIATGSQDKTAKIWDLEQL-----RLLGVLSGHTRGVWCVSFSK-NDQLLATC---SGD 526 (775)
T ss_pred -HHHHhhcccccceEecCCCceEEecccccceeeecccCc-----eEEEEeeCCccceEEEEecc-ccceeEec---cCC
Confidence 001247789999999999999999999999999999964 46789999999999999999 66999996 799
Q ss_pred CeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhccc
Q 000080 2344 INVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus 2344 ~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~~ 2385 (2389)
+|||||.+ .+..|+++|+||+..|--++|-..|...+|-|
T Consensus 527 ~TvKIW~i--s~fSClkT~eGH~~aVlra~F~~~~~qliS~~ 566 (775)
T KOG0319|consen 527 KTVKIWSI--STFSCLKTFEGHTSAVLRASFIRNGKQLISAG 566 (775)
T ss_pred ceEEEEEe--ccceeeeeecCccceeEeeeeeeCCcEEEecc
Confidence 99999998 68899999999999999999999999998876
No 32
>KOG0284 consensus Polyadenylation factor I complex, subunit PFS2 [RNA processing and modification]
Probab=99.65 E-value=1.5e-16 Score=188.69 Aligned_cols=143 Identities=17% Similarity=0.228 Sum_probs=126.0
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.||++.|+++|.+++||..||.||.|+..- .-++.++ +| |...|++++|||+...|+|+|+||+|+|||.
T Consensus 140 ~Vr~m~ws~~g~wmiSgD~gG~iKyWqpnm-nnVk~~~---ah------h~eaIRdlafSpnDskF~t~SdDg~ikiWdf 209 (464)
T KOG0284|consen 140 PVRTMKWSHNGTWMISGDKGGMIKYWQPNM-NNVKIIQ---AH------HAEAIRDLAFSPNDSKFLTCSDDGTIKIWDF 209 (464)
T ss_pred cceeEEEccCCCEEEEcCCCceEEecccch-hhhHHhh---Hh------hhhhhheeccCCCCceeEEecCCCeEEEEec
Confidence 579999999999999999999999999753 3333332 23 5588999999999999999999999999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
... ++-..+.||...|.+|+|+| .-.+|||+ |.|++||+||+ .++.|+.+|.+|.+-|..+-+++.|||
T Consensus 210 ~~~-----kee~vL~GHgwdVksvdWHP-~kgLiasg---skDnlVKlWDp--rSg~cl~tlh~HKntVl~~~f~~n~N~ 278 (464)
T KOG0284|consen 210 RMP-----KEERVLRGHGWDVKSVDWHP-TKGLIASG---SKDNLVKLWDP--RSGSCLATLHGHKNTVLAVKFNPNGNW 278 (464)
T ss_pred cCC-----chhheeccCCCCcceeccCC-ccceeEEc---cCCceeEeecC--CCcchhhhhhhccceEEEEEEcCCCCe
Confidence 865 45567799999999999999 88899997 59999999998 588999999999999999999999999
Q ss_pred hhcc
Q 000080 2381 ALSK 2384 (2389)
Q Consensus 2381 ~~s~ 2384 (2389)
.|+-
T Consensus 279 Llt~ 282 (464)
T KOG0284|consen 279 LLTG 282 (464)
T ss_pred eEEc
Confidence 8874
No 33
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=99.64 E-value=1.7e-15 Score=171.64 Aligned_cols=171 Identities=14% Similarity=0.151 Sum_probs=138.7
Q ss_pred ccceeeccccccccccccccCCCCcCc---eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEec-----------
Q 000080 2193 GIGASALGWETQDDFEDYVDPPATVEN---ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYG----------- 2258 (2389)
Q Consensus 2193 ~~~Asg~~~d~~~~~~~~~d~~atv~n---i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~----------- 2258 (2389)
....+| +-|.+.|+|+...+....+. -+|.+|..||+...|++|-++|.||+||+++..|...+.
T Consensus 96 rWMyTg-seDgt~kIWdlR~~~~qR~~~~~spVn~vvlhpnQteLis~dqsg~irvWDl~~~~c~~~liPe~~~~i~sl~ 174 (311)
T KOG0315|consen 96 RWMYTG-SEDGTVKIWDLRSLSCQRNYQHNSPVNTVVLHPNQTELISGDQSGNIRVWDLGENSCTHELIPEDDTSIQSLT 174 (311)
T ss_pred eEEEec-CCCceEEEEeccCcccchhccCCCCcceEEecCCcceEEeecCCCcEEEEEccCCccccccCCCCCcceeeEE
Confidence 456677 88889999998765554332 467899999999999999999999999999775543321
Q ss_pred ccCCCCC-------------------------C---CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCccc
Q 000080 2259 VLPAANV-------------------------P---PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRP 2310 (2389)
Q Consensus 2259 vl~gh~~-------------------------p---~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~ 2310 (2389)
+-++..| | ...|...+....||||++.||++|.|.||++|++++. .+.
T Consensus 175 v~~dgsml~a~nnkG~cyvW~l~~~~~~s~l~P~~k~~ah~~~il~C~lSPd~k~lat~ssdktv~iwn~~~~----~kl 250 (311)
T KOG0315|consen 175 VMPDGSMLAAANNKGNCYVWRLLNHQTASELEPVHKFQAHNGHILRCLLSPDVKYLATCSSDKTVKIWNTDDF----FKL 250 (311)
T ss_pred EcCCCcEEEEecCCccEEEEEccCCCccccceEhhheecccceEEEEEECCCCcEEEeecCCceEEEEecCCc----eee
Confidence 1111110 0 4568888999999999999999999999999999864 244
Q ss_pred ceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080 2311 MESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus 2311 l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
-..++||+.++++.+||. ||++|+|| |.|+++||||+ +.++.++..+||.....|++.
T Consensus 251 e~~l~gh~rWvWdc~FS~-dg~YlvTa---ssd~~~rlW~~--~~~k~v~qy~gh~K~~vc~~l 308 (311)
T KOG0315|consen 251 ELVLTGHQRWVWDCAFSA-DGEYLVTA---SSDHTARLWDL--SAGKEVRQYQGHHKAAVCVAL 308 (311)
T ss_pred EEEeecCCceEEeeeecc-CccEEEec---CCCCceeeccc--ccCceeeecCCcccccEEEEe
Confidence 567899999999999999 99999997 58899999998 678889999999999998875
No 34
>KOG0285 consensus Pleiotropic regulator 1 [RNA processing and modification]
Probab=99.64 E-value=1.2e-15 Score=178.56 Aligned_cols=172 Identities=14% Similarity=0.195 Sum_probs=146.6
Q ss_pred cccceeeccccccccccccc--cCCCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCC
Q 000080 2192 AGIGASALGWETQDDFEDYV--DPPATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPP 2267 (2389)
Q Consensus 2192 ~~~~Asg~~~d~~~~~~~~~--d~~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~ 2267 (2389)
.--.|+| +-|.+.++|+.. ....|+.+ -.||.|+||+-.+|+.|++.|+.||.||+...+-++.|.
T Consensus 163 n~wf~tg-s~DrtikIwDlatg~LkltltGhi~~vr~vavS~rHpYlFs~gedk~VKCwDLe~nkvIR~Yh--------- 232 (460)
T KOG0285|consen 163 NEWFATG-SADRTIKIWDLATGQLKLTLTGHIETVRGVAVSKRHPYLFSAGEDKQVKCWDLEYNKVIRHYH--------- 232 (460)
T ss_pred ceeEEec-CCCceeEEEEcccCeEEEeecchhheeeeeeecccCceEEEecCCCeeEEEechhhhhHHHhc---------
Confidence 4446777 778888888874 33344443 256999999999999999999999999999998888772
Q ss_pred CCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080 2268 PYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus 2268 ~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
||.+.|++++..|.-+.|++|+.|.|+|+||+++. ..+..+.||...|.+|.+.|-|++++ |+ |.|.|||
T Consensus 233 -GHlS~V~~L~lhPTldvl~t~grDst~RvWDiRtr-----~~V~~l~GH~~~V~~V~~~~~dpqvi-t~---S~D~tvr 302 (460)
T KOG0285|consen 233 -GHLSGVYCLDLHPTLDVLVTGGRDSTIRVWDIRTR-----ASVHVLSGHTNPVASVMCQPTDPQVI-TG---SHDSTVR 302 (460)
T ss_pred -cccceeEEEeccccceeEEecCCcceEEEeeeccc-----ceEEEecCCCCcceeEEeecCCCceE-Ee---cCCceEE
Confidence 78899999999999999999999999999999985 46888999999999999998666655 64 7999999
Q ss_pred EeeCCCCCCCceEEEEeecCcEEEEeecccchhhhccc
Q 000080 2348 VWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus 2348 LWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~~ 2385 (2389)
|||+ ..++...++..|..-|++++.+|+.+---|.|
T Consensus 303 lWDl--~agkt~~tlt~hkksvral~lhP~e~~fASas 338 (460)
T KOG0285|consen 303 LWDL--RAGKTMITLTHHKKSVRALCLHPKENLFASAS 338 (460)
T ss_pred Eeee--ccCceeEeeecccceeeEEecCCchhhhhccC
Confidence 9998 46888999999999999999999987666655
No 35
>KOG0276 consensus Vesicle coat complex COPI, beta' subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.63 E-value=1.2e-15 Score=186.91 Aligned_cols=144 Identities=15% Similarity=0.154 Sum_probs=131.1
Q ss_pred cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEE
Q 000080 2217 VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVC 2296 (2389)
Q Consensus 2217 v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVk 2296 (2389)
+.+++||+..|=+--+++++||+|+.||+++..+++.+.+|. .|.+.|++|+-.|.--.+.|+|+|-+||
T Consensus 53 V~~~PvRa~kfiaRknWiv~GsDD~~IrVfnynt~ekV~~Fe----------AH~DyIR~iavHPt~P~vLtsSDDm~iK 122 (794)
T KOG0276|consen 53 VSEVPVRAAKFIARKNWIVTGSDDMQIRVFNYNTGEKVKTFE----------AHSDYIRSIAVHPTLPYVLTSSDDMTIK 122 (794)
T ss_pred ecccchhhheeeeccceEEEecCCceEEEEecccceeeEEee----------ccccceeeeeecCCCCeEEecCCccEEE
Confidence 335688999999999999999999999999999999999984 3679999999999999999999999999
Q ss_pred EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080 2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus 2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
+||-+.+ -.+.++++||+..|.+|+|+|.|-+..||+ |-|+|||+|.+ .+..+..+|+||+.+|+||.+-+
T Consensus 123 lW~we~~----wa~~qtfeGH~HyVMqv~fnPkD~ntFaS~---sLDrTVKVWsl--gs~~~nfTl~gHekGVN~Vdyy~ 193 (794)
T KOG0276|consen 123 LWDWENE----WACEQTFEGHEHYVMQVAFNPKDPNTFASA---SLDRTVKVWSL--GSPHPNFTLEGHEKGVNCVDYYT 193 (794)
T ss_pred EeeccCc----eeeeeEEcCcceEEEEEEecCCCccceeee---eccccEEEEEc--CCCCCceeeeccccCcceEEecc
Confidence 9999864 257789999999999999999999999997 69999999998 45567899999999999999999
Q ss_pred cch
Q 000080 2377 LLN 2379 (2389)
Q Consensus 2377 ~~~ 2379 (2389)
-|+
T Consensus 194 ~gd 196 (794)
T KOG0276|consen 194 GGD 196 (794)
T ss_pred CCC
Confidence 885
No 36
>KOG0284 consensus Polyadenylation factor I complex, subunit PFS2 [RNA processing and modification]
Probab=99.63 E-value=3.9e-16 Score=185.13 Aligned_cols=178 Identities=14% Similarity=0.174 Sum_probs=146.5
Q ss_pred cccCccccccccccccceeeccccccccccccccCCC--Cc--CceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCcee
Q 000080 2179 DLTGGLAFGIPGYAGIGASALGWETQDDFEDYVDPPA--TV--ENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKAT 2254 (2389)
Q Consensus 2179 ~~~~~~~~~~~g~~~~~Asg~~~d~~~~~~~~~d~~a--tv--~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l 2254 (2389)
+..+..||+- -|.--++- +.|.+.++|+|..+.. .+ ++--|++++|||...+|||||.|..|||||.++|+|+
T Consensus 181 eaIRdlafSp--nDskF~t~-SdDg~ikiWdf~~~kee~vL~GHgwdVksvdWHP~kgLiasgskDnlVKlWDprSg~cl 257 (464)
T KOG0284|consen 181 EAIRDLAFSP--NDSKFLTC-SDDGTIKIWDFRMPKEERVLRGHGWDVKSVDWHPTKGLIASGSKDNLVKLWDPRSGSCL 257 (464)
T ss_pred hhhheeccCC--CCceeEEe-cCCCeEEEEeccCCchhheeccCCCCcceeccCCccceeEEccCCceeEeecCCCcchh
Confidence 3445667754 33334444 7789999999973322 22 2345799999999999999999999999999999999
Q ss_pred eEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEE
Q 000080 2255 ATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVI 2334 (2389)
Q Consensus 2255 ~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslL 2334 (2389)
.|+. +|.+.|.+|.|+|+|++|+|+|.|.++|+.|+++- +.++++++|.+.|++++++|-.-.++
T Consensus 258 ~tlh----------~HKntVl~~~f~~n~N~Llt~skD~~~kv~DiR~m-----kEl~~~r~Hkkdv~~~~WhP~~~~lf 322 (464)
T KOG0284|consen 258 ATLH----------GHKNTVLAVKFNPNGNWLLTGSKDQSCKVFDIRTM-----KELFTYRGHKKDVTSLTWHPLNESLF 322 (464)
T ss_pred hhhh----------hccceEEEEEEcCCCCeeEEccCCceEEEEehhHh-----HHHHHhhcchhhheeeccccccccce
Confidence 9983 58899999999999999999999999999999964 57899999999999999999877888
Q ss_pred EEeecCCCCCeEEEeeCCCCCCCceE-EEEeecCcEEEEeecccch
Q 000080 2335 AAAGHSSNGINVVVWDTLAPPTSSRA-SITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus 2335 ASAG~sS~D~TVrLWD~l~~tg~~v~-sL~GH~~~V~svA~~~~~~ 2379 (2389)
+||| .|+.|..|.+. ..+.+. .-.+|.+.|++++.+|.|-
T Consensus 323 tsgg---~Dgsvvh~~v~--~~~p~~~i~~AHd~~iwsl~~hPlGh 363 (464)
T KOG0284|consen 323 TSGG---SDGSVVHWVVG--LEEPLGEIPPAHDGEIWSLAYHPLGH 363 (464)
T ss_pred eecc---CCCceEEEecc--ccccccCCCcccccceeeeeccccce
Confidence 8865 89999999983 233343 3377999999999999985
No 37
>KOG0293 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.62 E-value=4.2e-15 Score=176.35 Aligned_cols=212 Identities=17% Similarity=0.312 Sum_probs=144.5
Q ss_pred CCCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEE
Q 000080 35 TAPTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAA 114 (2389)
Q Consensus 35 ~ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaA 114 (2389)
.+|+-++=-+.++++ | ..+|-|+...-.|.|.-.++.-++.. -.++||.. +|..++|||| ..+++|
T Consensus 221 ~~htdEVWfl~FS~n--G-kyLAsaSkD~Taiiw~v~~d~~~kl~------~tlvgh~~--~V~yi~wSPD---dryLla 286 (519)
T KOG0293|consen 221 QDHTDEVWFLQFSHN--G-KYLASASKDSTAIIWIVVYDVHFKLK------KTLVGHSQ--PVSYIMWSPD---DRYLLA 286 (519)
T ss_pred hhCCCcEEEEEEcCC--C-eeEeeccCCceEEEEEEecCcceeee------eeeecccC--ceEEEEECCC---CCeEEe
Confidence 467888888888988 8 58999999999999955555555544 66778866 9999999999 677776
Q ss_pred e-cCCeEEEEeeCCCCCCCCccceeeEEec--ccceEEEEeecCCCCeEEEEecc--eEEeeccC---CcEEEEEEeecc
Q 000080 115 A-SENCIFVFAHDSASSKGSFCWSQNAILV--QGTKVEAIEWTGSGDGIVAGGME--TVLWKKKN---TLWEIAWKFKEN 186 (2389)
Q Consensus 115 S-yDntIRVw~~d~~~~kgd~~W~~~~tL~--hssTV~sIAWSpdG~rLaSggdD--V~IW~~~~---s~Wecvwt~~~~ 186 (2389)
+ .|..+++|.-+. |+. .-... +..+|-+.+|-|||.++++||.| +.+|+... +.|+-+
T Consensus 287 Cg~~e~~~lwDv~t----gd~----~~~y~~~~~~S~~sc~W~pDg~~~V~Gs~dr~i~~wdlDgn~~~~W~gv------ 352 (519)
T KOG0293|consen 287 CGFDEVLSLWDVDT----GDL----RHLYPSGLGFSVSSCAWCPDGFRFVTGSPDRTIIMWDLDGNILGNWEGV------ 352 (519)
T ss_pred cCchHheeeccCCc----chh----hhhcccCcCCCcceeEEccCCceeEecCCCCcEEEecCCcchhhccccc------
Confidence 5 688999998772 221 11111 35789999999999999999998 88998532 445532
Q ss_pred ccceEEEEeecCCCc-eEeeecccc---cccCC-----------------------------------------------
Q 000080 187 YPQNLVSATWSIEGP-SATAASMSQ---LDLLG----------------------------------------------- 215 (2389)
Q Consensus 187 ~~~~ivsvaWSpdG~-fATag~dik---f~~~~----------------------------------------------- 215 (2389)
..+.+++++=++||+ +.+.+.|.+ |.++.
T Consensus 353 r~~~v~dlait~Dgk~vl~v~~d~~i~l~~~e~~~dr~lise~~~its~~iS~d~k~~LvnL~~qei~LWDl~e~~lv~k 432 (519)
T KOG0293|consen 353 RDPKVHDLAITYDGKYVLLVTVDKKIRLYNREARVDRGLISEEQPITSFSISKDGKLALVNLQDQEIHLWDLEENKLVRK 432 (519)
T ss_pred ccceeEEEEEcCCCcEEEEEecccceeeechhhhhhhccccccCceeEEEEcCCCcEEEEEcccCeeEEeecchhhHHHH
Confidence 334455555566666 333333222 11110
Q ss_pred ------------------------CCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccCceEE
Q 000080 216 ------------------------PKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLL 271 (2389)
Q Consensus 216 ------------------------~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILA 271 (2389)
+...+.-|+||-.-.+. ...+..+|+..||||+|+|. ...++|
T Consensus 433 Y~Ghkq~~fiIrSCFgg~~~~fiaSGSED~kvyIWhr~sgk-ll~~LsGHs~~vNcVswNP~------------~p~m~A 499 (519)
T KOG0293|consen 433 YFGHKQGHFIIRSCFGGGNDKFIASGSEDSKVYIWHRISGK-LLAVLSGHSKTVNCVSWNPA------------DPEMFA 499 (519)
T ss_pred hhcccccceEEEeccCCCCcceEEecCCCceEEEEEccCCc-eeEeecCCcceeeEEecCCC------------CHHHhh
Confidence 01111225555322222 22345899999999999995 455699
Q ss_pred eeecCCeEEEEEeecC
Q 000080 272 TCCLDGTVRLWCEMDS 287 (2389)
Q Consensus 272 ScSdDgTVRLW~e~d~ 287 (2389)
|+|||||||||...++
T Consensus 500 SasDDgtIRIWg~~~~ 515 (519)
T KOG0293|consen 500 SASDDGTIRIWGPSDN 515 (519)
T ss_pred ccCCCCeEEEecCCcc
Confidence 9999999999986543
No 38
>PLN00181 protein SPA1-RELATED; Provisional
Probab=99.62 E-value=6.4e-15 Score=194.19 Aligned_cols=172 Identities=16% Similarity=0.205 Sum_probs=138.6
Q ss_pred ccceeeccccccccccccccC--CCCc--CceeEEEEEEcC-CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCC
Q 000080 2193 GIGASALGWETQDDFEDYVDP--PATV--ENISTRAFSSHP-LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPP 2267 (2389)
Q Consensus 2193 ~~~Asg~~~d~~~~~~~~~d~--~atv--~ni~VrsVAFsP-dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~ 2267 (2389)
..+|++ ++|.+.++|+.... ..++ +.-.|++++|+| ++.+|+|||.|++|++||+.+++++.++. .
T Consensus 546 ~~las~-~~Dg~v~lWd~~~~~~~~~~~~H~~~V~~l~~~p~~~~~L~Sgs~Dg~v~iWd~~~~~~~~~~~---~----- 616 (793)
T PLN00181 546 SQVASS-NFEGVVQVWDVARSQLVTEMKEHEKRVWSIDYSSADPTLLASGSDDGSVKLWSINQGVSIGTIK---T----- 616 (793)
T ss_pred CEEEEE-eCCCeEEEEECCCCeEEEEecCCCCCEEEEEEcCCCCCEEEEEcCCCEEEEEECCCCcEEEEEe---c-----
Confidence 356677 77888888876421 1111 123579999997 78999999999999999999999888874 1
Q ss_pred CCCCCCEEEEEEC-CCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080 2268 PYALASISALQFD-HYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus 2268 ~GH~~~V~sVaFS-PDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
| ..|.+++|+ ++|+.||+|+.||+|++||++++. .++.++.+|...|.+++|. +|+.|+|+ +.|++|
T Consensus 617 --~-~~v~~v~~~~~~g~~latgs~dg~I~iwD~~~~~----~~~~~~~~h~~~V~~v~f~--~~~~lvs~---s~D~~i 684 (793)
T PLN00181 617 --K-ANICCVQFPSESGRSLAFGSADHKVYYYDLRNPK----LPLCTMIGHSKTVSYVRFV--DSSTLVSS---STDNTL 684 (793)
T ss_pred --C-CCeEEEEEeCCCCCEEEEEeCCCeEEEEECCCCC----ccceEecCCCCCEEEEEEe--CCCEEEEE---ECCCEE
Confidence 2 569999995 679999999999999999998752 3667888999999999997 46889887 489999
Q ss_pred EEeeCCCC----CCCceEEEEeecCcEEEEeecccchhhhccc
Q 000080 2347 VVWDTLAP----PTSSRASITCHEGLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus 2347 rLWD~l~~----tg~~v~sL~GH~~~V~svA~~~~~~~~~s~~ 2385 (2389)
+|||+... ..+.++++.+|.+.+.+++++++|+++.+-.
T Consensus 685 kiWd~~~~~~~~~~~~l~~~~gh~~~i~~v~~s~~~~~lasgs 727 (793)
T PLN00181 685 KLWDLSMSISGINETPLHSFMGHTNVKNFVGLSVSDGYIATGS 727 (793)
T ss_pred EEEeCCCCccccCCcceEEEcCCCCCeeEEEEcCCCCEEEEEe
Confidence 99998422 2356889999999999999999999887643
No 39
>KOG0273 consensus Beta-transducin family (WD-40 repeat) protein [Chromatin structure and dynamics]
Probab=99.60 E-value=6.3e-15 Score=177.26 Aligned_cols=140 Identities=19% Similarity=0.248 Sum_probs=126.4
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCC---------EEEEEe
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGH---------RFASAA 2290 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~---------~LASgS 2290 (2389)
.+|.++.|+|.|.+|+|+|+|+|+|||..+++.+...|+ +|+..|+.+.+||+|. .+|+++
T Consensus 360 g~V~alk~n~tg~LLaS~SdD~TlkiWs~~~~~~~~~l~----------~Hskei~t~~wsp~g~v~~n~~~~~~l~sas 429 (524)
T KOG0273|consen 360 GEVNALKWNPTGSLLASCSDDGTLKIWSMGQSNSVHDLQ----------AHSKEIYTIKWSPTGPVTSNPNMNLMLASAS 429 (524)
T ss_pred CceEEEEECCCCceEEEecCCCeeEeeecCCCcchhhhh----------hhccceeeEeecCCCCccCCCcCCceEEEee
Confidence 477999999999999999999999999999998888875 4778999999999874 899999
Q ss_pred CCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEE
Q 000080 2291 LDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYD 2370 (2389)
Q Consensus 2291 ~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~ 2370 (2389)
.|+||++||+..| .|+.++..|+.+|++|+|+| +|++||+| +.|+-|.||++ ++++.+++.+ -.+.|.
T Consensus 430 ~dstV~lwdv~~g-----v~i~~f~kH~~pVysvafS~-~g~ylAsG---s~dg~V~iws~--~~~~l~~s~~-~~~~If 497 (524)
T KOG0273|consen 430 FDSTVKLWDVESG-----VPIHTLMKHQEPVYSVAFSP-NGRYLASG---SLDGCVHIWST--KTGKLVKSYQ-GTGGIF 497 (524)
T ss_pred cCCeEEEEEccCC-----ceeEeeccCCCceEEEEecC-CCcEEEec---CCCCeeEeccc--cchheeEeec-CCCeEE
Confidence 9999999999987 68899999999999999999 99999995 79999999998 6788888888 456789
Q ss_pred EEeecccchhh
Q 000080 2371 LFLPLKLLNFA 2381 (2389)
Q Consensus 2371 svA~~~~~~~~ 2381 (2389)
.|..+..|+-+
T Consensus 498 el~Wn~~G~kl 508 (524)
T KOG0273|consen 498 ELCWNAAGDKL 508 (524)
T ss_pred EEEEcCCCCEE
Confidence 99999998753
No 40
>PLN00181 protein SPA1-RELATED; Provisional
Probab=99.59 E-value=1.7e-14 Score=190.30 Aligned_cols=171 Identities=12% Similarity=0.117 Sum_probs=135.7
Q ss_pred ccccceeeccccccccccccccCCC----------CcC-ceeEEEEEEcCC-CCeEEEEeCCCcEEEeecCCCceeeEec
Q 000080 2191 YAGIGASALGWETQDDFEDYVDPPA----------TVE-NISTRAFSSHPL-RPFFLVGSSNTHIYLWEFGKDKATATYG 2258 (2389)
Q Consensus 2191 ~~~~~Asg~~~d~~~~~~~~~d~~a----------tv~-ni~VrsVAFsPd-G~~LASGS~DgTIRLWDl~tGk~l~Tl~ 2258 (2389)
.+.+.|+| +.|...++|++..... .+. .-.|.+++|+|. +.+||||+.||+|+|||+.+++.+.++.
T Consensus 494 dg~~latg-g~D~~I~iwd~~~~~~~~~~~~~~~~~~~~~~~v~~l~~~~~~~~~las~~~Dg~v~lWd~~~~~~~~~~~ 572 (793)
T PLN00181 494 DGEFFATA-GVNKKIKIFECESIIKDGRDIHYPVVELASRSKLSGICWNSYIKSQVASSNFEGVVQVWDVARSQLVTEMK 572 (793)
T ss_pred CCCEEEEE-eCCCEEEEEECCcccccccccccceEEecccCceeeEEeccCCCCEEEEEeCCCeEEEEECCCCeEEEEec
Confidence 34578888 8888999997632110 011 124688999885 7899999999999999999998888773
Q ss_pred ccCCCCCCCCCCCCCEEEEEECC-CCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEe
Q 000080 2259 VLPAANVPPPYALASISALQFDH-YGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAA 2337 (2389)
Q Consensus 2259 vl~gh~~p~~GH~~~V~sVaFSP-DG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASA 2337 (2389)
+|.+.|++|+|+| +|+.||||+.||+|++||++++ ..+.++..| ..|.+++|++++|.+||+|
T Consensus 573 ----------~H~~~V~~l~~~p~~~~~L~Sgs~Dg~v~iWd~~~~-----~~~~~~~~~-~~v~~v~~~~~~g~~latg 636 (793)
T PLN00181 573 ----------EHEKRVWSIDYSSADPTLLASGSDDGSVKLWSINQG-----VSIGTIKTK-ANICCVQFPSESGRSLAFG 636 (793)
T ss_pred ----------CCCCCEEEEEEcCCCCCEEEEEcCCCEEEEEECCCC-----cEEEEEecC-CCeEEEEEeCCCCCEEEEE
Confidence 4678999999997 7999999999999999999986 345566544 5789999987689999996
Q ss_pred ecCCCCCeEEEeeCCCCCCC-ceEEEEeecCcEEEEeecccchhhhcc
Q 000080 2338 GHSSNGINVVVWDTLAPPTS-SRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2338 G~sS~D~TVrLWD~l~~tg~-~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
+.|++|++||+. +.+ .+..+.+|...|+++++. +++..++-
T Consensus 637 ---s~dg~I~iwD~~--~~~~~~~~~~~h~~~V~~v~f~-~~~~lvs~ 678 (793)
T PLN00181 637 ---SADHKVYYYDLR--NPKLPLCTMIGHSKTVSYVRFV-DSSTLVSS 678 (793)
T ss_pred ---eCCCeEEEEECC--CCCccceEecCCCCCEEEEEEe-CCCEEEEE
Confidence 589999999984 333 478889999999999997 56665553
No 41
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=99.59 E-value=3.2e-14 Score=153.90 Aligned_cols=144 Identities=17% Similarity=0.270 Sum_probs=125.0
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
+|.+++|+|++++|++|+.|++|++||+.+++....+. +|...+..+.|+|+|+.|++++.||+|++||+
T Consensus 11 ~i~~~~~~~~~~~l~~~~~~g~i~i~~~~~~~~~~~~~----------~~~~~i~~~~~~~~~~~l~~~~~~~~i~i~~~ 80 (289)
T cd00200 11 GVTCVAFSPDGKLLATGSGDGTIKVWDLETGELLRTLK----------GHTGPVRDVAASADGTYLASGSSDKTIRLWDL 80 (289)
T ss_pred CEEEEEEcCCCCEEEEeecCcEEEEEEeeCCCcEEEEe----------cCCcceeEEEECCCCCEEEEEcCCCeEEEEEc
Confidence 46999999999999999999999999998887666653 35577899999999999999999999999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
+++ +....+.+|...+.+++|+| ++++++++ +.|+.|++||+ .+++.+..+.+|.+.+.++++++++++
T Consensus 81 ~~~-----~~~~~~~~~~~~i~~~~~~~-~~~~~~~~---~~~~~i~~~~~--~~~~~~~~~~~~~~~i~~~~~~~~~~~ 149 (289)
T cd00200 81 ETG-----ECVRTLTGHTSYVSSVAFSP-DGRILSSS---SRDKTIKVWDV--ETGKCLTTLRGHTDWVNSVAFSPDGTF 149 (289)
T ss_pred Ccc-----cceEEEeccCCcEEEEEEcC-CCCEEEEe---cCCCeEEEEEC--CCcEEEEEeccCCCcEEEEEEcCcCCE
Confidence 975 35667788999999999999 78888875 36999999998 356778889999999999999999888
Q ss_pred hhccc
Q 000080 2381 ALSKC 2385 (2389)
Q Consensus 2381 ~~s~~ 2385 (2389)
++.-+
T Consensus 150 l~~~~ 154 (289)
T cd00200 150 VASSS 154 (289)
T ss_pred EEEEc
Confidence 77644
No 42
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.59 E-value=6.3e-15 Score=166.12 Aligned_cols=113 Identities=20% Similarity=0.269 Sum_probs=105.4
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.|+++.|+-||++.++++.|.|||||+.-.|.+++||. ||...|..++.+.|...||||+.|+.|.+||+
T Consensus 19 aV~avryN~dGnY~ltcGsdrtvrLWNp~rg~liktYs----------ghG~EVlD~~~s~Dnskf~s~GgDk~v~vwDV 88 (307)
T KOG0316|consen 19 AVRAVRYNVDGNYCLTCGSDRTVRLWNPLRGALIKTYS----------GHGHEVLDAALSSDNSKFASCGGDKAVQVWDV 88 (307)
T ss_pred ceEEEEEccCCCEEEEcCCCceEEeecccccceeeeec----------CCCceeeeccccccccccccCCCCceEEEEEc
Confidence 57999999999999999999999999999999999994 56688999999999999999999999999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
+|| +..+.+.||.+.|+.|+|+- +.+.++|| |.|.+||+||-.
T Consensus 89 ~TG-----kv~Rr~rgH~aqVNtV~fNe-esSVv~Sg---sfD~s~r~wDCR 131 (307)
T KOG0316|consen 89 NTG-----KVDRRFRGHLAQVNTVRFNE-ESSVVASG---SFDSSVRLWDCR 131 (307)
T ss_pred ccC-----eeeeecccccceeeEEEecC-cceEEEec---cccceeEEEEcc
Confidence 998 57888999999999999998 88999986 689999999974
No 43
>KOG0275 consensus Conserved WD40 repeat-containing protein [General function prediction only]
Probab=99.58 E-value=1.2e-15 Score=176.04 Aligned_cols=164 Identities=17% Similarity=0.196 Sum_probs=135.0
Q ss_pred cceeeccccccccccccc------cCCCC-cC-----ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccC
Q 000080 2194 IGASALGWETQDDFEDYV------DPPAT-VE-----NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLP 2261 (2389)
Q Consensus 2194 ~~Asg~~~d~~~~~~~~~------d~~at-v~-----ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~ 2261 (2389)
-+++| +-|.-.++|.|. |.... -+ .-.|.+++|+.|...||||+.||.|++|-+.+|+|++.|. .
T Consensus 227 yLvsg-SvDGFiEVWny~~GKlrKDLkYQAqd~fMMmd~aVlci~FSRDsEMlAsGsqDGkIKvWri~tG~ClRrFd--r 303 (508)
T KOG0275|consen 227 YLVSG-SVDGFIEVWNYTTGKLRKDLKYQAQDNFMMMDDAVLCISFSRDSEMLASGSQDGKIKVWRIETGQCLRRFD--R 303 (508)
T ss_pred eEeec-cccceeeeehhccchhhhhhhhhhhcceeecccceEEEeecccHHHhhccCcCCcEEEEEEecchHHHHhh--h
Confidence 35556 556667777774 11111 11 1378999999999999999999999999999999999885 2
Q ss_pred CCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCC
Q 000080 2262 AANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSS 2341 (2389)
Q Consensus 2262 gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS 2341 (2389)
.|+..|+++.||.|+..+.|+|.|.|||+--+.+| +++..+.||+..|+.+.|.+ ||..|.|+ |
T Consensus 304 -------AHtkGvt~l~FSrD~SqiLS~sfD~tvRiHGlKSG-----K~LKEfrGHsSyvn~a~ft~-dG~~iisa---S 367 (508)
T KOG0275|consen 304 -------AHTKGVTCLSFSRDNSQILSASFDQTVRIHGLKSG-----KCLKEFRGHSSYVNEATFTD-DGHHIISA---S 367 (508)
T ss_pred -------hhccCeeEEEEccCcchhhcccccceEEEeccccc-----hhHHHhcCccccccceEEcC-CCCeEEEe---c
Confidence 36788999999999999999999999999999987 57888899999999999999 99999997 6
Q ss_pred CCCeEEEeeCCCCCCCceEEEE--eecCcEEEEeecccc
Q 000080 2342 NGINVVVWDTLAPPTSSRASIT--CHEGLYDLFLPLKLL 2378 (2389)
Q Consensus 2342 ~D~TVrLWD~l~~tg~~v~sL~--GH~~~V~svA~~~~~ 2378 (2389)
.|+|||+|+. .+++|+.++. +-+-.|.+|-+.|+.
T Consensus 368 sDgtvkvW~~--KtteC~~Tfk~~~~d~~vnsv~~~PKn 404 (508)
T KOG0275|consen 368 SDGTVKVWHG--KTTECLSTFKPLGTDYPVNSVILLPKN 404 (508)
T ss_pred CCccEEEecC--cchhhhhhccCCCCcccceeEEEcCCC
Confidence 8999999997 5778887774 345566777777664
No 44
>KOG0265 consensus U5 snRNP-specific protein-like factor and related proteins [RNA processing and modification]
Probab=99.58 E-value=1.2e-14 Score=168.13 Aligned_cols=171 Identities=13% Similarity=0.126 Sum_probs=141.5
Q ss_pred ccccceeecccccccccccc-ccCCC--C--cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC
Q 000080 2191 YAGIGASALGWETQDDFEDY-VDPPA--T--VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV 2265 (2389)
Q Consensus 2191 ~~~~~Asg~~~d~~~~~~~~-~d~~a--t--v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~ 2265 (2389)
.+...|+| |+|-.+-+|.. -|-+. . .+...|..+.|.+|+..|+|+|.|++|+.||.++|++++.++
T Consensus 58 ~gs~~aSg-G~Dr~I~LWnv~gdceN~~~lkgHsgAVM~l~~~~d~s~i~S~gtDk~v~~wD~~tG~~~rk~k------- 129 (338)
T KOG0265|consen 58 DGSCFASG-GSDRAIVLWNVYGDCENFWVLKGHSGAVMELHGMRDGSHILSCGTDKTVRGWDAETGKRIRKHK------- 129 (338)
T ss_pred CCCeEeec-CCcceEEEEeccccccceeeeccccceeEeeeeccCCCEEEEecCCceEEEEecccceeeehhc-------
Confidence 66778888 88888888874 22221 1 233577999999999999999999999999999999998775
Q ss_pred CCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCC
Q 000080 2266 PPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGI 2344 (2389)
Q Consensus 2266 p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~ 2344 (2389)
+|...|.++.-+--| .++.||+.|||+||||+++.+ ++++++ -...+.+|+|.. ++..+.||| -|+
T Consensus 130 ---~h~~~vNs~~p~rrg~~lv~SgsdD~t~kl~D~R~k~-----~~~t~~-~kyqltAv~f~d-~s~qv~sgg---Idn 196 (338)
T KOG0265|consen 130 ---GHTSFVNSLDPSRRGPQLVCSGSDDGTLKLWDIRKKE-----AIKTFE-NKYQLTAVGFKD-TSDQVISGG---IDN 196 (338)
T ss_pred ---cccceeeecCccccCCeEEEecCCCceEEEEeecccc-----hhhccc-cceeEEEEEecc-cccceeecc---ccC
Confidence 577999999955556 688999999999999999752 444443 246788999998 778888886 899
Q ss_pred eEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080 2345 NVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2345 TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
.||+||+. .+.+++.+.||.+.|+.++.++.|.+.||.
T Consensus 197 ~ikvWd~r--~~d~~~~lsGh~DtIt~lsls~~gs~llsn 234 (338)
T KOG0265|consen 197 DIKVWDLR--KNDGLYTLSGHADTITGLSLSRYGSFLLSN 234 (338)
T ss_pred ceeeeccc--cCcceEEeecccCceeeEEeccCCCccccc
Confidence 99999984 567899999999999999999999999985
No 45
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=99.57 E-value=7.3e-14 Score=151.09 Aligned_cols=168 Identities=19% Similarity=0.246 Sum_probs=133.4
Q ss_pred cceeeccccccccccccccC--CCC--cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCC
Q 000080 2194 IGASALGWETQDDFEDYVDP--PAT--VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPY 2269 (2389)
Q Consensus 2194 ~~Asg~~~d~~~~~~~~~d~--~at--v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~G 2269 (2389)
..+.+ +.+....+|++... ... .+...+..+.|+|++++|++++.|++|++||+.+++.+..+. +
T Consensus 23 ~l~~~-~~~g~i~i~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~l~~~~~~~~i~i~~~~~~~~~~~~~----------~ 91 (289)
T cd00200 23 LLATG-SGDGTIKVWDLETGELLRTLKGHTGPVRDVAASADGTYLASGSSDKTIRLWDLETGECVRTLT----------G 91 (289)
T ss_pred EEEEe-ecCcEEEEEEeeCCCcEEEEecCCcceeEEEECCCCCEEEEEcCCCeEEEEEcCcccceEEEe----------c
Confidence 34444 44555555554321 011 122345789999999999999999999999999887777763 3
Q ss_pred CCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEe
Q 000080 2270 ALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVW 2349 (2389)
Q Consensus 2270 H~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLW 2349 (2389)
|...|.+++|+|+++.+++++.||.|++||++++ ++...+.+|...+.+++|+| ++.+|+++ +.|++|++|
T Consensus 92 ~~~~i~~~~~~~~~~~~~~~~~~~~i~~~~~~~~-----~~~~~~~~~~~~i~~~~~~~-~~~~l~~~---~~~~~i~i~ 162 (289)
T cd00200 92 HTSYVSSVAFSPDGRILSSSSRDKTIKVWDVETG-----KCLTTLRGHTDWVNSVAFSP-DGTFVASS---SQDGTIKLW 162 (289)
T ss_pred cCCcEEEEEEcCCCCEEEEecCCCeEEEEECCCc-----EEEEEeccCCCcEEEEEEcC-cCCEEEEE---cCCCcEEEE
Confidence 5578999999999999999999999999999975 45667778999999999999 78999875 469999999
Q ss_pred eCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080 2350 DTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2350 D~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
|+ .+++.++.+..|...+.+++.+|+++..+.
T Consensus 163 d~--~~~~~~~~~~~~~~~i~~~~~~~~~~~l~~ 194 (289)
T cd00200 163 DL--RTGKCVATLTGHTGEVNSVAFSPDGEKLLS 194 (289)
T ss_pred Ec--cccccceeEecCccccceEEECCCcCEEEE
Confidence 98 456778899999999999999999966543
No 46
>PTZ00420 coronin; Provisional
Probab=99.57 E-value=7.2e-14 Score=177.91 Aligned_cols=153 Identities=12% Similarity=0.159 Sum_probs=115.9
Q ss_pred ccccceeeccccccccccccccC---C-------CCc--CceeEEEEEEcCCCCe-EEEEeCCCcEEEeecCCCceeeEe
Q 000080 2191 YAGIGASALGWETQDDFEDYVDP---P-------ATV--ENISTRAFSSHPLRPF-FLVGSSNTHIYLWEFGKDKATATY 2257 (2389)
Q Consensus 2191 ~~~~~Asg~~~d~~~~~~~~~d~---~-------atv--~ni~VrsVAFsPdG~~-LASGS~DgTIRLWDl~tGk~l~Tl 2257 (2389)
...++|+| +.|.+.++|+.... . .++ +.-.|.+|+|||++.. |||||.|++|+|||+++++.+.++
T Consensus 86 ~~~lLASg-S~DgtIrIWDi~t~~~~~~~i~~p~~~L~gH~~~V~sVaf~P~g~~iLaSgS~DgtIrIWDl~tg~~~~~i 164 (568)
T PTZ00420 86 FSEILASG-SEDLTIRVWEIPHNDESVKEIKDPQCILKGHKKKISIIDWNPMNYYIMCSSGFDSFVNIWDIENEKRAFQI 164 (568)
T ss_pred CCCEEEEE-eCCCeEEEEECCCCCccccccccceEEeecCCCcEEEEEECCCCCeEEEEEeCCCeEEEEECCCCcEEEEE
Confidence 34578888 88889999987421 0 111 1235799999999985 579999999999999999877665
Q ss_pred cccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEE-----EEecCCCC
Q 000080 2258 GVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDV-----SYITSSGS 2332 (2389)
Q Consensus 2258 ~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sV-----AFSP~DGs 2332 (2389)
. |...|.+++|+|||+.||+++.|++|+|||++++ +.+.++.+|.+.+... .|++ ++.
T Consensus 165 ~-----------~~~~V~SlswspdG~lLat~s~D~~IrIwD~Rsg-----~~i~tl~gH~g~~~s~~v~~~~fs~-d~~ 227 (568)
T PTZ00420 165 N-----------MPKKLSSLKWNIKGNLLSGTCVGKHMHIIDPRKQ-----EIASSFHIHDGGKNTKNIWIDGLGG-DDN 227 (568)
T ss_pred e-----------cCCcEEEEEECCCCCEEEEEecCCEEEEEECCCC-----cEEEEEecccCCceeEEEEeeeEcC-CCC
Confidence 2 2356999999999999999999999999999986 3567888998865443 3457 888
Q ss_pred EEEEeecCC-CCCeEEEeeCCCCCCCceEEE
Q 000080 2333 VIAAAGHSS-NGINVVVWDTLAPPTSSRASI 2362 (2389)
Q Consensus 2333 lLASAG~sS-~D~TVrLWD~l~~tg~~v~sL 2362 (2389)
+|+|+|++. .+++|+|||+. ..++.++.+
T Consensus 228 ~IlTtG~d~~~~R~VkLWDlr-~~~~pl~~~ 257 (568)
T PTZ00420 228 YILSTGFSKNNMREMKLWDLK-NTTSALVTM 257 (568)
T ss_pred EEEEEEcCCCCccEEEEEECC-CCCCceEEE
Confidence 999887432 23689999984 234555544
No 47
>KOG0267 consensus Microtubule severing protein katanin p80 subunit B (contains WD40 repeats) [Cell cycle control, cell division, chromosome partitioning]
Probab=99.56 E-value=2.6e-15 Score=186.57 Aligned_cols=166 Identities=19% Similarity=0.292 Sum_probs=141.7
Q ss_pred ceeeccccccccccccccCCCCc----CceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCC
Q 000080 2195 GASALGWETQDDFEDYVDPPATV----ENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYA 2270 (2389)
Q Consensus 2195 ~Asg~~~d~~~~~~~~~d~~atv----~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH 2270 (2389)
++.| ||++-.-+|...++.+.. +.-+|.+|.|+++..+|++|+.||+||+||+..++.++|+. ||
T Consensus 43 ~~~G-g~~~k~~L~~i~kp~~i~S~~~hespIeSl~f~~~E~LlaagsasgtiK~wDleeAk~vrtLt----------gh 111 (825)
T KOG0267|consen 43 LVTG-GEDEKVNLWAIGKPNAITSLTGHESPIESLTFDTSERLLAAGSASGTIKVWDLEEAKIVRTLT----------GH 111 (825)
T ss_pred eccC-CCceeeccccccCCchhheeeccCCcceeeecCcchhhhcccccCCceeeeehhhhhhhhhhh----------cc
Confidence 4456 888888888877554432 22468999999999999999999999999999999999884 67
Q ss_pred CCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEee
Q 000080 2271 LASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWD 2350 (2389)
Q Consensus 2271 ~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD 2350 (2389)
...+.+|+|+|-|.++|+||.|+-+++||++..| +..++.+|...|+.++|+| +|+++|++| +|.+|+|||
T Consensus 112 ~~~~~sv~f~P~~~~~a~gStdtd~~iwD~Rk~G-----c~~~~~s~~~vv~~l~lsP-~Gr~v~~g~---ed~tvki~d 182 (825)
T KOG0267|consen 112 LLNITSVDFHPYGEFFASGSTDTDLKIWDIRKKG-----CSHTYKSHTRVVDVLRLSP-DGRWVASGG---EDNTVKIWD 182 (825)
T ss_pred ccCcceeeeccceEEeccccccccceehhhhccC-----ceeeecCCcceeEEEeecC-CCceeeccC---Ccceeeeec
Confidence 7889999999999999999999999999999643 5677788999999999999 999999975 899999999
Q ss_pred CCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080 2351 TLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2351 ~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
. +.|+....|.+|++.+.++-++|. +++|+
T Consensus 183 ~--~agk~~~ef~~~e~~v~sle~hp~-e~Lla 212 (825)
T KOG0267|consen 183 L--TAGKLSKEFKSHEGKVQSLEFHPL-EVLLA 212 (825)
T ss_pred c--cccccccccccccccccccccCch-hhhhc
Confidence 7 567778999999999999998874 44443
No 48
>KOG0269 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.55 E-value=1.6e-14 Score=180.88 Aligned_cols=144 Identities=18% Similarity=0.328 Sum_probs=118.0
Q ss_pred EEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-CCEEEEEeCCCcEEEeeC
Q 000080 2223 RAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-GHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2223 rsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~DgTVkLWDl 2300 (2389)
..+.||+.-+ +|+|||+||+||+||++..+.+.|++ +.+..|+.|+|+|- |+.||++.+.|.+++||+
T Consensus 137 ~~ldfh~tep~iliSGSQDg~vK~~DlR~~~S~~t~~----------~nSESiRDV~fsp~~~~~F~s~~dsG~lqlWDl 206 (839)
T KOG0269|consen 137 NKLDFHSTEPNILISGSQDGTVKCWDLRSKKSKSTFR----------SNSESIRDVKFSPGYGNKFASIHDSGYLQLWDL 206 (839)
T ss_pred eeeeeccCCccEEEecCCCceEEEEeeeccccccccc----------ccchhhhceeeccCCCceEEEecCCceEEEeec
Confidence 6779999876 79999999999999999999988886 35688999999986 799999999999999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
+... ++...+.+|.+.|.++.|+| ++.+||||| .|++|||||+..+-.+...+++ -...|.+|..-|.-..
T Consensus 207 Rqp~----r~~~k~~AH~GpV~c~nwhP-nr~~lATGG---RDK~vkiWd~t~~~~~~~~tIn-Tiapv~rVkWRP~~~~ 277 (839)
T KOG0269|consen 207 RQPD----RCEKKLTAHNGPVLCLNWHP-NREWLATGG---RDKMVKIWDMTDSRAKPKHTIN-TIAPVGRVKWRPARSY 277 (839)
T ss_pred cCch----hHHHHhhcccCceEEEeecC-CCceeeecC---CCccEEEEeccCCCccceeEEe-ecceeeeeeeccCccc
Confidence 9864 68889999999999999999 999999975 9999999998422223344443 3345667777666555
Q ss_pred hhccc
Q 000080 2381 ALSKC 2385 (2389)
Q Consensus 2381 ~~s~~ 2385 (2389)
-|--|
T Consensus 278 hLAtc 282 (839)
T KOG0269|consen 278 HLATC 282 (839)
T ss_pred hhhhh
Confidence 44444
No 49
>KOG0301 consensus Phospholipase A2-activating protein (contains WD40 repeats) [Lipid transport and metabolism]
Probab=99.55 E-value=2.6e-14 Score=177.55 Aligned_cols=164 Identities=18% Similarity=0.246 Sum_probs=136.7
Q ss_pred cccccceeeccccccccccccccCCCCcC--ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCC
Q 000080 2190 GYAGIGASALGWETQDDFEDYVDPPATVE--NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPP 2267 (2389)
Q Consensus 2190 g~~~~~Asg~~~d~~~~~~~~~d~~atv~--ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~ 2267 (2389)
|.++.+.|| +||.+.++|...+....+. .-+|++|++=|++ .++|||.|.+||+|.= |++++||.
T Consensus 110 ~~~~~~iSg-SWD~TakvW~~~~l~~~l~gH~asVWAv~~l~e~-~~vTgsaDKtIklWk~--~~~l~tf~--------- 176 (745)
T KOG0301|consen 110 GEDGTLISG-SWDSTAKVWRIGELVYSLQGHTASVWAVASLPEN-TYVTGSADKTIKLWKG--GTLLKTFS--------- 176 (745)
T ss_pred CCcCceEec-ccccceEEecchhhhcccCCcchheeeeeecCCC-cEEeccCcceeeeccC--Cchhhhhc---------
Confidence 345567889 9999999998754444333 2577999999988 8999999999999994 78899984
Q ss_pred CCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080 2268 PYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus 2268 ~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
||++-|+.+++=|++ .|+|++.||.||+||+ +| ..+..+.||+..|++++..+ +++.|+|+| +|+|+|
T Consensus 177 -gHtD~VRgL~vl~~~-~flScsNDg~Ir~w~~-~g-----e~l~~~~ghtn~vYsis~~~-~~~~Ivs~g---EDrtlr 244 (745)
T KOG0301|consen 177 -GHTDCVRGLAVLDDS-HFLSCSNDGSIRLWDL-DG-----EVLLEMHGHTNFVYSISMAL-SDGLIVSTG---EDRTLR 244 (745)
T ss_pred -cchhheeeeEEecCC-CeEeecCCceEEEEec-cC-----ceeeeeeccceEEEEEEecC-CCCeEEEec---CCceEE
Confidence 688999999999985 5899999999999999 44 36788899999999999887 678888875 999999
Q ss_pred EeeCCCCCCCceEEEEeecCcEEEEeecccchhhh
Q 000080 2348 VWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus 2348 LWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
||+. +.|+|.++--+..||++...+.||-++
T Consensus 245 iW~~----~e~~q~I~lPttsiWsa~~L~NgDIvv 275 (745)
T KOG0301|consen 245 IWKK----DECVQVITLPTTSIWSAKVLLNGDIVV 275 (745)
T ss_pred Eeec----CceEEEEecCccceEEEEEeeCCCEEE
Confidence 9996 588999984444899999988887543
No 50
>KOG0281 consensus Beta-TrCP (transducin repeats containing)/Slimb proteins [Function unknown]
Probab=99.54 E-value=4.9e-15 Score=172.68 Aligned_cols=166 Identities=14% Similarity=0.125 Sum_probs=131.4
Q ss_pred ccccceeeccccccccccccccCC--CCcC--ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCC--
Q 000080 2191 YAGIGASALGWETQDDFEDYVDPP--ATVE--NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAAN-- 2264 (2389)
Q Consensus 2191 ~~~~~Asg~~~d~~~~~~~~~d~~--atv~--ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~-- 2264 (2389)
.|+...|| .-|.++++|+..+.. ..+. ..+|-.+.| +.+.|+|||.|.||++||+.+|+++.||. +|-
T Consensus 206 DD~kiVSG-lrDnTikiWD~n~~~c~~~L~GHtGSVLCLqy--d~rviisGSSDsTvrvWDv~tge~l~tli---hHcea 279 (499)
T KOG0281|consen 206 DDEKIVSG-LRDNTIKIWDKNSLECLKILTGHTGSVLCLQY--DERVIVSGSSDSTVRVWDVNTGEPLNTLI---HHCEA 279 (499)
T ss_pred cchhhhcc-cccCceEEeccccHHHHHhhhcCCCcEEeeec--cceEEEecCCCceEEEEeccCCchhhHHh---hhcce
Confidence 35567778 667788888764221 1111 134455544 56799999999999999999999987763 221
Q ss_pred ------------------------C--C--------CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCccc
Q 000080 2265 ------------------------V--P--------PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRP 2310 (2389)
Q Consensus 2265 ------------------------~--p--------~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~ 2310 (2389)
| | .-||.+.|..|.|+. ++++|||.|+|||+|++.|+ ..
T Consensus 280 VLhlrf~ng~mvtcSkDrsiaVWdm~sps~it~rrVLvGHrAaVNvVdfd~--kyIVsASgDRTikvW~~st~-----ef 352 (499)
T KOG0281|consen 280 VLHLRFSNGYMVTCSKDRSIAVWDMASPTDITLRRVLVGHRAAVNVVDFDD--KYIVSASGDRTIKVWSTSTC-----EF 352 (499)
T ss_pred eEEEEEeCCEEEEecCCceeEEEeccCchHHHHHHHHhhhhhheeeecccc--ceEEEecCCceEEEEeccce-----ee
Confidence 0 0 568999999999965 49999999999999999987 57
Q ss_pred ceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080 2311 MESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus 2311 l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
++++.||...|.++.|. |++++|| |.|+||||||+ ..|.|++-|+||+.-|+|+-|..+
T Consensus 353 vRtl~gHkRGIAClQYr---~rlvVSG---SSDntIRlwdi--~~G~cLRvLeGHEeLvRciRFd~k 411 (499)
T KOG0281|consen 353 VRTLNGHKRGIACLQYR---DRLVVSG---SSDNTIRLWDI--ECGACLRVLEGHEELVRCIRFDNK 411 (499)
T ss_pred ehhhhcccccceehhcc---CeEEEec---CCCceEEEEec--cccHHHHHHhchHHhhhheeecCc
Confidence 89999999999888886 4888885 79999999998 678999999999999999988764
No 51
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.54 E-value=4.4e-14 Score=171.01 Aligned_cols=143 Identities=19% Similarity=0.212 Sum_probs=117.7
Q ss_pred eEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-CCEEEEEeCCCcEEEe
Q 000080 2221 STRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-GHRFASAALDGTVCTW 2298 (2389)
Q Consensus 2221 ~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~DgTVkLW 2298 (2389)
+|+.+-|+|++. .+++||+|+.+++||+.++.-..++ .||+++|++.+|+|. ++.++|||-||+||||
T Consensus 112 pv~~~~f~~~d~t~l~s~sDd~v~k~~d~s~a~v~~~l----------~~htDYVR~g~~~~~~~hivvtGsYDg~vrl~ 181 (487)
T KOG0310|consen 112 PVHVTKFSPQDNTMLVSGSDDKVVKYWDLSTAYVQAEL----------SGHTDYVRCGDISPANDHIVVTGSYDGKVRLW 181 (487)
T ss_pred ceeEEEecccCCeEEEecCCCceEEEEEcCCcEEEEEe----------cCCcceeEeeccccCCCeEEEecCCCceEEEE
Confidence 347789999766 6899999999999999877743333 368899999999998 5799999999999999
Q ss_pred eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080 2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
|+++.+ .+..++ .|..+|.+|.|.| +|++||||| ++.||+||+. ..++.+..+..|..-|+|+....++
T Consensus 182 DtR~~~----~~v~el-nhg~pVe~vl~lp-sgs~iasAg----Gn~vkVWDl~-~G~qll~~~~~H~KtVTcL~l~s~~ 250 (487)
T KOG0310|consen 182 DTRSLT----SRVVEL-NHGCPVESVLALP-SGSLIASAG----GNSVKVWDLT-TGGQLLTSMFNHNKTVTCLRLASDS 250 (487)
T ss_pred EeccCC----ceeEEe-cCCCceeeEEEcC-CCCEEEEcC----CCeEEEEEec-CCceehhhhhcccceEEEEEeecCC
Confidence 999853 355555 5999999999999 999999985 6789999984 2334456666699999999999998
Q ss_pred hhhhcc
Q 000080 2379 NFALSK 2384 (2389)
Q Consensus 2379 ~~~~s~ 2384 (2389)
.+.||-
T Consensus 251 ~rLlS~ 256 (487)
T KOG0310|consen 251 TRLLSG 256 (487)
T ss_pred ceEeec
Confidence 777763
No 52
>KOG0275 consensus Conserved WD40 repeat-containing protein [General function prediction only]
Probab=99.53 E-value=3.5e-15 Score=172.33 Aligned_cols=151 Identities=15% Similarity=0.180 Sum_probs=129.1
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
++.+..|+|||++|+|||-||-|.+||+-+|+..+.++-....+ ..-|.+.|.++.||.|...+|||+.||.||+|.+
T Consensus 215 h~EcA~FSPDgqyLvsgSvDGFiEVWny~~GKlrKDLkYQAqd~--fMMmd~aVlci~FSRDsEMlAsGsqDGkIKvWri 292 (508)
T KOG0275|consen 215 HVECARFSPDGQYLVSGSVDGFIEVWNYTTGKLRKDLKYQAQDN--FMMMDDAVLCISFSRDSEMLASGSQDGKIKVWRI 292 (508)
T ss_pred chhheeeCCCCceEeeccccceeeeehhccchhhhhhhhhhhcc--eeecccceEEEeecccHHHhhccCcCCcEEEEEE
Confidence 34566899999999999999999999999999876654211122 2235688999999999999999999999999999
Q ss_pred CCCCccCcccceeee-ecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccch
Q 000080 2301 EVGGRSNVRPMESCL-CFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~-gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~ 2379 (2389)
++| .+++.+. +|+..|.++.||. |++.|.|+ |.|.||||--+ ..|+|++.+.||+.-|+...+.++|+
T Consensus 293 ~tG-----~ClRrFdrAHtkGvt~l~FSr-D~SqiLS~---sfD~tvRiHGl--KSGK~LKEfrGHsSyvn~a~ft~dG~ 361 (508)
T KOG0275|consen 293 ETG-----QCLRRFDRAHTKGVTCLSFSR-DNSQILSA---SFDQTVRIHGL--KSGKCLKEFRGHSSYVNEATFTDDGH 361 (508)
T ss_pred ecc-----hHHHHhhhhhccCeeEEEEcc-Ccchhhcc---cccceEEEecc--ccchhHHHhcCccccccceEEcCCCC
Confidence 998 3555554 7999999999999 77878886 58999999998 57899999999999999999999999
Q ss_pred hhhcc
Q 000080 2380 FALSK 2384 (2389)
Q Consensus 2380 ~~~s~ 2384 (2389)
.++|.
T Consensus 362 ~iisa 366 (508)
T KOG0275|consen 362 HIISA 366 (508)
T ss_pred eEEEe
Confidence 99874
No 53
>KOG0318 consensus WD40 repeat stress protein/actin interacting protein [Cytoskeleton]
Probab=99.53 E-value=7.6e-14 Score=169.57 Aligned_cols=166 Identities=16% Similarity=0.242 Sum_probs=129.9
Q ss_pred eccccccccccccccCCCCcCceeEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEE
Q 000080 2198 ALGWETQDDFEDYVDPPATVENISTRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISA 2276 (2389)
Q Consensus 2198 g~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~s 2276 (2389)
.|.||+.--+-++.-+.+ .|.+++|-|..| +++|||+|++|.+++=..-+-..+++ -|+..|++
T Consensus 131 ~F~~DSG~SvGei~GhSr-----~ins~~~KpsRPfRi~T~sdDn~v~ffeGPPFKFk~s~r----------~HskFV~~ 195 (603)
T KOG0318|consen 131 VFLWDSGNSVGEITGHSR-----RINSVDFKPSRPFRIATGSDDNTVAFFEGPPFKFKSSFR----------EHSKFVNC 195 (603)
T ss_pred EEEecCCCccceeeccce-----eEeeeeccCCCceEEEeccCCCeEEEeeCCCeeeeeccc----------ccccceee
Confidence 356666665555533333 347789999999 49999999999999943345556664 27799999
Q ss_pred EEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC----
Q 000080 2277 LQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL---- 2352 (2389)
Q Consensus 2277 VaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l---- 2352 (2389)
|.|||||.+|||++.||+|.|+|=.+|+ .+..+..-.+|.+.|++++|+| |++.+||+ |.|+|+||||+.
T Consensus 196 VRysPDG~~Fat~gsDgki~iyDGktge--~vg~l~~~~aHkGsIfalsWsP-Ds~~~~T~---SaDkt~KIWdVs~~sl 269 (603)
T KOG0318|consen 196 VRYSPDGSRFATAGSDGKIYIYDGKTGE--KVGELEDSDAHKGSIFALSWSP-DSTQFLTV---SADKTIKIWDVSTNSL 269 (603)
T ss_pred EEECCCCCeEEEecCCccEEEEcCCCcc--EEEEecCCCCccccEEEEEECC-CCceEEEe---cCCceEEEEEeeccce
Confidence 9999999999999999999999999984 2233333458999999999999 99999998 699999999961
Q ss_pred -------------------------------------CCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080 2353 -------------------------------------APPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2353 -------------------------------------~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
......++.+.||...|++++.+++|..++|-
T Consensus 270 v~t~~~~~~v~dqqvG~lWqkd~lItVSl~G~in~ln~~d~~~~~~i~GHnK~ITaLtv~~d~~~i~Sg 338 (603)
T KOG0318|consen 270 VSTWPMGSTVEDQQVGCLWQKDHLITVSLSGTINYLNPSDPSVLKVISGHNKSITALTVSPDGKTIYSG 338 (603)
T ss_pred EEEeecCCchhceEEEEEEeCCeEEEEEcCcEEEEecccCCChhheecccccceeEEEEcCCCCEEEee
Confidence 01112245578899999999999999888763
No 54
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.52 E-value=6.3e-14 Score=174.94 Aligned_cols=144 Identities=19% Similarity=0.233 Sum_probs=124.5
Q ss_pred eEEEEEEcCCCCeEEEEeCC-CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2221 STRAFSSHPLRPFFLVGSSN-THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~D-gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
+|.+++|+..|.+||-|+.- |.+-+|+|.+..-+ ++ +.||...++++++||||+++|+|++||.||+||
T Consensus 309 ~I~t~~~N~tGDWiA~g~~klgQLlVweWqsEsYV--lK--------QQgH~~~i~~l~YSpDgq~iaTG~eDgKVKvWn 378 (893)
T KOG0291|consen 309 KILTVSFNSTGDWIAFGCSKLGQLLVWEWQSESYV--LK--------QQGHSDRITSLAYSPDGQLIATGAEDGKVKVWN 378 (893)
T ss_pred eeeEEEecccCCEEEEcCCccceEEEEEeecccee--ee--------ccccccceeeEEECCCCcEEEeccCCCcEEEEe
Confidence 56889999999999998866 89999999755433 33 246889999999999999999999999999999
Q ss_pred CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC----------------------------
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT---------------------------- 2351 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~---------------------------- 2351 (2389)
...| .++.|+..|+..|..|.|+. +|+.|.|+ |-|||||.||+
T Consensus 379 ~~Sg-----fC~vTFteHts~Vt~v~f~~-~g~~llss---SLDGtVRAwDlkRYrNfRTft~P~p~QfscvavD~sGel 449 (893)
T KOG0291|consen 379 TQSG-----FCFVTFTEHTSGVTAVQFTA-RGNVLLSS---SLDGTVRAWDLKRYRNFRTFTSPEPIQFSCVAVDPSGEL 449 (893)
T ss_pred ccCc-----eEEEEeccCCCceEEEEEEe-cCCEEEEe---ecCCeEEeeeecccceeeeecCCCceeeeEEEEcCCCCE
Confidence 9986 68999999999999999999 99999996 69999999996
Q ss_pred --------------CCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080 2352 --------------LAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2352 --------------l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
..++|+.+-.|.||+++|.++++++.|+-..|
T Consensus 450 V~AG~~d~F~IfvWS~qTGqllDiLsGHEgPVs~l~f~~~~~~LaS 495 (893)
T KOG0291|consen 450 VCAGAQDSFEIFVWSVQTGQLLDILSGHEGPVSGLSFSPDGSLLAS 495 (893)
T ss_pred EEeeccceEEEEEEEeecCeeeehhcCCCCcceeeEEccccCeEEe
Confidence 12566666778999999999999999985544
No 55
>KOG0277 consensus Peroxisomal targeting signal type 2 receptor [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.52 E-value=1e-13 Score=157.86 Aligned_cols=146 Identities=20% Similarity=0.207 Sum_probs=124.1
Q ss_pred eEEEEEEcCC-CCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-CCEEEEEeCCCcEEEe
Q 000080 2221 STRAFSSHPL-RPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-GHRFASAALDGTVCTW 2298 (2389)
Q Consensus 2221 ~VrsVAFsPd-G~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~DgTVkLW 2298 (2389)
.|.+|.+++. ++.++++|.|+||||||...++.++||. ||..-|.+.+|||. ++.|||+|.|++++||
T Consensus 106 EV~Svdwn~~~r~~~ltsSWD~TiKLW~~~r~~Sv~Tf~----------gh~~~Iy~a~~sp~~~nlfas~Sgd~~l~lw 175 (311)
T KOG0277|consen 106 EVYSVDWNTVRRRIFLTSSWDGTIKLWDPNRPNSVQTFN----------GHNSCIYQAAFSPHIPNLFASASGDGTLRLW 175 (311)
T ss_pred heEEeccccccceeEEeeccCCceEeecCCCCcceEeec----------CCccEEEEEecCCCCCCeEEEccCCceEEEE
Confidence 4588899995 5578888999999999999999999985 56799999999987 6999999999999999
Q ss_pred eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080 2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
|++..| ++ ..+..|+..+.+..|+.-+-.+||||| .|++||.||+.. -...+..|.||.-.|+.|.+||--
T Consensus 176 dvr~~g----k~-~~i~ah~~Eil~cdw~ky~~~vl~Tg~---vd~~vr~wDir~-~r~pl~eL~gh~~AVRkvk~Sph~ 246 (311)
T KOG0277|consen 176 DVRSPG----KF-MSIEAHNSEILCCDWSKYNHNVLATGG---VDNLVRGWDIRN-LRTPLFELNGHGLAVRKVKFSPHH 246 (311)
T ss_pred EecCCC----ce-eEEEeccceeEeecccccCCcEEEecC---CCceEEEEehhh-ccccceeecCCceEEEEEecCcch
Confidence 999875 33 348899999999999977888999974 899999999842 224478899999999999999987
Q ss_pred hhhhccc
Q 000080 2379 NFALSKC 2385 (2389)
Q Consensus 2379 ~~~~s~~ 2385 (2389)
.=.|-.|
T Consensus 247 ~~lLaSa 253 (311)
T KOG0277|consen 247 ASLLASA 253 (311)
T ss_pred hhHhhhc
Confidence 6666554
No 56
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.51 E-value=1.4e-13 Score=156.21 Aligned_cols=212 Identities=25% Similarity=0.444 Sum_probs=163.2
Q ss_pred CCCCCCcceeec-CCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEE-
Q 000080 36 APTRSTSTIDWL-PDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLA- 113 (2389)
Q Consensus 36 ap~~~~~ai~wl-pD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIa- 113 (2389)
+|.-.+-+.+|. |-+++ ++|.++=+.-||.| . +. ++-+.|.++...|...|.+|+|-|. .-|.+|
T Consensus 54 Gh~GPVwqv~wahPk~G~--iLAScsYDgkVIiW--k------e~-~g~w~k~~e~~~h~~SVNsV~waph--eygl~La 120 (299)
T KOG1332|consen 54 GHSGPVWKVAWAHPKFGT--ILASCSYDGKVIIW--K------EE-NGRWTKAYEHAAHSASVNSVAWAPH--EYGLLLA 120 (299)
T ss_pred CCCCCeeEEeecccccCc--EeeEeecCceEEEE--e------cC-CCchhhhhhhhhhcccceeeccccc--ccceEEE
Confidence 455566788998 88866 89999999999999 2 22 3467788888777678999999995 234455
Q ss_pred -EecCCeEEEEeeCCCCCCCCccceeeEEe-cccceEEEEeecCC---C-----------CeEEEEecc--eEEeeccCC
Q 000080 114 -AASENCIFVFAHDSASSKGSFCWSQNAIL-VQGTKVEAIEWTGS---G-----------DGIVAGGME--TVLWKKKNT 175 (2389)
Q Consensus 114 -ASyDntIRVw~~d~~~~kgd~~W~~~~tL-~hssTV~sIAWSpd---G-----------~rLaSggdD--V~IW~~~~s 175 (2389)
||+|++|+|...+. + + .|...-.. .|+--|.+++|.|. | +||+|||-| |+||+..++
T Consensus 121 casSDG~vsvl~~~~--~-g--~w~t~ki~~aH~~GvnsVswapa~~~g~~~~~~~~~~~krlvSgGcDn~VkiW~~~~~ 195 (299)
T KOG1332|consen 121 CASSDGKVSVLTYDS--S-G--GWTTSKIVFAHEIGVNSVSWAPASAPGSLVDQGPAAKVKRLVSGGCDNLVKIWKFDSD 195 (299)
T ss_pred EeeCCCcEEEEEEcC--C-C--CccchhhhhccccccceeeecCcCCCccccccCcccccceeeccCCccceeeeecCCc
Confidence 46899999999882 1 1 35543333 48889999999998 7 889999998 999999999
Q ss_pred cEEEEEEeeccccceEE-EEeecCC-Cc----eEeeecccccccCCCCCCCceeEEEeeCCCcccee--ecccCCCCeeE
Q 000080 176 LWEIAWKFKENYPQNLV-SATWSIE-GP----SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIK--LELCHPQPVSM 247 (2389)
Q Consensus 176 ~Wecvwt~~~~~~~~iv-svaWSpd-G~----fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~--ve~aH~qdVn~ 247 (2389)
.|+...++ +.|...| +|+|+|. |. +|||+.|.+ |+||-.+++.+-.. +...-+..|..
T Consensus 196 ~w~~e~~l--~~H~dwVRDVAwaP~~gl~~s~iAS~SqDg~------------viIwt~~~e~e~wk~tll~~f~~~~w~ 261 (299)
T KOG1332|consen 196 SWKLERTL--EGHKDWVRDVAWAPSVGLPKSTIASCSQDGT------------VIIWTKDEEYEPWKKTLLEEFPDVVWR 261 (299)
T ss_pred chhhhhhh--hhcchhhhhhhhccccCCCceeeEEecCCCc------------EEEEEecCccCcccccccccCCcceEE
Confidence 99988764 3445555 9999996 43 999999865 66676655544333 33445688999
Q ss_pred EEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeecCCcccc
Q 000080 248 VQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMDSGKTRK 292 (2389)
Q Consensus 248 V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d~Gk~kk 292 (2389)
++|+++ .|+|+-++.|+-|.||+|.-.|+-++
T Consensus 262 vSWS~s-------------Gn~LaVs~GdNkvtlwke~~~Gkw~~ 293 (299)
T KOG1332|consen 262 VSWSLS-------------GNILAVSGGDNKVTLWKENVDGKWEE 293 (299)
T ss_pred EEEecc-------------ccEEEEecCCcEEEEEEeCCCCcEEE
Confidence 999993 68899999999999999998887754
No 57
>KOG0308 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.51 E-value=1.7e-13 Score=169.38 Aligned_cols=177 Identities=13% Similarity=0.150 Sum_probs=142.5
Q ss_pred cceeeccccccccccccccCC----CCc--CceeEEEEEE-cCCCCeEEEEeCCCcEEEeecCCC--ceeeEecccCCCC
Q 000080 2194 IGASALGWETQDDFEDYVDPP----ATV--ENISTRAFSS-HPLRPFFLVGSSNTHIYLWEFGKD--KATATYGVLPAAN 2264 (2389)
Q Consensus 2194 ~~Asg~~~d~~~~~~~~~d~~----atv--~ni~VrsVAF-sPdG~~LASGS~DgTIRLWDl~tG--k~l~Tl~vl~gh~ 2264 (2389)
.+.|. +=|++.++|....-. .++ +.-+|.+++. -++...+||||-|+.|.|||+.+| +.+.++...+...
T Consensus 87 tlIS~-SsDtTVK~W~~~~~~~~c~stir~H~DYVkcla~~ak~~~lvaSgGLD~~IflWDin~~~~~l~~s~n~~t~~s 165 (735)
T KOG0308|consen 87 TLISA-SSDTTVKVWNAHKDNTFCMSTIRTHKDYVKCLAYIAKNNELVASGGLDRKIFLWDINTGTATLVASFNNVTVNS 165 (735)
T ss_pred ceEEe-cCCceEEEeecccCcchhHhhhhcccchheeeeecccCceeEEecCCCccEEEEEccCcchhhhhhcccccccc
Confidence 45666 668888888763221 111 1125699999 899999999999999999999988 4555554322221
Q ss_pred CCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCC
Q 000080 2265 VPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGI 2344 (2389)
Q Consensus 2265 ~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~ 2344 (2389)
..-||...|+++|-+|.|..|++|+..+-+|+||.++. +.+..++||+..|+.+-.++ ||+.+.|| |.|+
T Consensus 166 -l~sG~k~siYSLA~N~t~t~ivsGgtek~lr~wDprt~-----~kimkLrGHTdNVr~ll~~d-DGt~~ls~---sSDg 235 (735)
T KOG0308|consen 166 -LGSGPKDSIYSLAMNQTGTIIVSGGTEKDLRLWDPRTC-----KKIMKLRGHTDNVRVLLVND-DGTRLLSA---SSDG 235 (735)
T ss_pred -CCCCCccceeeeecCCcceEEEecCcccceEEeccccc-----cceeeeeccccceEEEEEcC-CCCeEeec---CCCc
Confidence 12388899999999999999999999999999999996 45778899999999999998 99999997 5899
Q ss_pred eEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080 2345 NVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2345 TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
||||||+ ...+|++++.-|..+||++.-+|+..-.-|
T Consensus 236 tIrlWdL--gqQrCl~T~~vH~e~VWaL~~~~sf~~vYs 272 (735)
T KOG0308|consen 236 TIRLWDL--GQQRCLATYIVHKEGVWALQSSPSFTHVYS 272 (735)
T ss_pred eEEeeec--cccceeeeEEeccCceEEEeeCCCcceEEe
Confidence 9999998 467899999999999999998887654433
No 58
>KOG0283 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.51 E-value=5.2e-14 Score=178.44 Aligned_cols=153 Identities=13% Similarity=0.079 Sum_probs=120.0
Q ss_pred CceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCC--------------------------------ceeeEe-----ccc
Q 000080 2218 ENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKD--------------------------------KATATY-----GVL 2260 (2389)
Q Consensus 2218 ~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tG--------------------------------k~l~Tl-----~vl 2260 (2389)
+...|+++.||+||+||||||.|+.||||.+... ..-++. ...
T Consensus 266 h~gaIw~mKFS~DGKyLAsaGeD~virVWkVie~e~~~~~~~~~~~~~~~~~~~s~~~p~~s~~~~~~~~~s~~~~~~~s 345 (712)
T KOG0283|consen 266 HKGAIWAMKFSHDGKYLASAGEDGVIRVWKVIESERMRVAEGDSSCMYFEYNANSQIEPSTSSEEKISSRTSSSRKGSQS 345 (712)
T ss_pred cCCcEEEEEeCCCCceeeecCCCceEEEEEEeccchhcccccccchhhhhhhhccccCccccccccccccccccccccCC
Confidence 3456799999999999999999999999998650 000000 000
Q ss_pred CC-----CCC-----C---CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEe
Q 000080 2261 PA-----ANV-----P---PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYI 2327 (2389)
Q Consensus 2261 ~g-----h~~-----p---~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFS 2327 (2389)
++ ... | ..||.+.|-.+.+|-++ +|.|+|.|.|||||++... .++..+. |...|++|+|+
T Consensus 346 ~~~~~p~~~f~f~ekP~~ef~GHt~DILDlSWSKn~-fLLSSSMDKTVRLWh~~~~-----~CL~~F~-HndfVTcVaFn 418 (712)
T KOG0283|consen 346 PCVLLPLKAFVFSEKPFCEFKGHTADILDLSWSKNN-FLLSSSMDKTVRLWHPGRK-----ECLKVFS-HNDFVTCVAFN 418 (712)
T ss_pred ccccCCCccccccccchhhhhccchhheecccccCC-eeEeccccccEEeecCCCc-----ceeeEEe-cCCeeEEEEec
Confidence 11 000 0 56999999999999885 8999999999999999864 4566654 99999999999
Q ss_pred cCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080 2328 TSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2328 P~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
|-|.++++|| |-|+.||||++ +..+-+...+.| .-|+++++.|+|..|+=
T Consensus 419 PvDDryFiSG---SLD~KvRiWsI--~d~~Vv~W~Dl~-~lITAvcy~PdGk~avI 468 (712)
T KOG0283|consen 419 PVDDRYFISG---SLDGKVRLWSI--SDKKVVDWNDLR-DLITAVCYSPDGKGAVI 468 (712)
T ss_pred ccCCCcEeec---ccccceEEeec--CcCeeEeehhhh-hhheeEEeccCCceEEE
Confidence 9999999995 79999999998 333445666666 78999999999999874
No 59
>KOG0267 consensus Microtubule severing protein katanin p80 subunit B (contains WD40 repeats) [Cell cycle control, cell division, chromosome partitioning]
Probab=99.51 E-value=1.5e-14 Score=179.85 Aligned_cols=162 Identities=20% Similarity=0.252 Sum_probs=134.8
Q ss_pred cccccccccccCC--CC----cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEE
Q 000080 2202 ETQDDFEDYVDPP--AT----VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASIS 2275 (2389)
Q Consensus 2202 d~~~~~~~~~d~~--at----v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~ 2275 (2389)
+.+.++|+..... +| ..|+ -+|+|||-|.+.|+||.|+.+++||.+..-|..+|. ||...|.
T Consensus 91 sgtiK~wDleeAk~vrtLtgh~~~~--~sv~f~P~~~~~a~gStdtd~~iwD~Rk~Gc~~~~~----------s~~~vv~ 158 (825)
T KOG0267|consen 91 SGTIKVWDLEEAKIVRTLTGHLLNI--TSVDFHPYGEFFASGSTDTDLKIWDIRKKGCSHTYK----------SHTRVVD 158 (825)
T ss_pred CCceeeeehhhhhhhhhhhccccCc--ceeeeccceEEeccccccccceehhhhccCceeeec----------CCcceeE
Confidence 3467777764222 23 3344 788999999999999999999999998788999985 4678899
Q ss_pred EEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCC
Q 000080 2276 ALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPP 2355 (2389)
Q Consensus 2276 sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~t 2355 (2389)
.++|+|||+++|+|++|++|++||+..| +....+.+|+..+.++.|+| ..-++|+| |.|+||++||+ .+
T Consensus 159 ~l~lsP~Gr~v~~g~ed~tvki~d~~ag-----k~~~ef~~~e~~v~sle~hp-~e~Lla~G---s~d~tv~f~dl--et 227 (825)
T KOG0267|consen 159 VLRLSPDGRWVASGGEDNTVKIWDLTAG-----KLSKEFKSHEGKVQSLEFHP-LEVLLAPG---SSDRTVRFWDL--ET 227 (825)
T ss_pred EEeecCCCceeeccCCcceeeeeccccc-----ccccccccccccccccccCc-hhhhhccC---CCCceeeeecc--ce
Confidence 9999999999999999999999999886 35667788999999999999 65777775 68999999998 34
Q ss_pred CCceEEEEeecCcEEEEeecccchhhhcccc
Q 000080 2356 TSSRASITCHEGLYDLFLPLKLLNFALSKCR 2386 (2389)
Q Consensus 2356 g~~v~sL~GH~~~V~svA~~~~~~~~~s~~~ 2386 (2389)
-..+-+......+|.|+++.++|..+++-|.
T Consensus 228 fe~I~s~~~~~~~v~~~~fn~~~~~~~~G~q 258 (825)
T KOG0267|consen 228 FEVISSGKPETDGVRSLAFNPDGKIVLSGEQ 258 (825)
T ss_pred eEEeeccCCccCCceeeeecCCceeeecCch
Confidence 4556667777999999999999999988764
No 60
>KOG0305 consensus Anaphase promoting complex, Cdc20, Cdh1, and Ama1 subunits [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=99.49 E-value=1.7e-13 Score=170.22 Aligned_cols=155 Identities=16% Similarity=0.202 Sum_probs=130.6
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCC---------------------------------CC-
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAAN---------------------------------VP- 2266 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~---------------------------------~p- 2266 (2389)
.|.+|.|+++|.+||.|-.+|+|.|||..+.+.++++.. .|. +.
T Consensus 219 ~vtSv~ws~~G~~LavG~~~g~v~iwD~~~~k~~~~~~~--~h~~rvg~laW~~~~lssGsr~~~I~~~dvR~~~~~~~~ 296 (484)
T KOG0305|consen 219 LVTSVKWSPDGSHLAVGTSDGTVQIWDVKEQKKTRTLRG--SHASRVGSLAWNSSVLSSGSRDGKILNHDVRISQHVVST 296 (484)
T ss_pred ceEEEEECCCCCEEEEeecCCeEEEEehhhccccccccC--CcCceeEEEeccCceEEEecCCCcEEEEEEecchhhhhh
Confidence 469999999999999999999999999988887777642 132 11
Q ss_pred CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080 2267 PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus 2267 ~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
..||...|..+++++||++||||+.|+.|.|||.... .+..++..|...|..++|.|-...+||||| |+.|++|
T Consensus 297 ~~~H~qeVCgLkws~d~~~lASGgnDN~~~Iwd~~~~-----~p~~~~~~H~aAVKA~awcP~q~~lLAsGG-Gs~D~~i 370 (484)
T KOG0305|consen 297 LQGHRQEVCGLKWSPDGNQLASGGNDNVVFIWDGLSP-----EPKFTFTEHTAAVKALAWCPWQSGLLATGG-GSADRCI 370 (484)
T ss_pred hhcccceeeeeEECCCCCeeccCCCccceEeccCCCc-----cccEEEeccceeeeEeeeCCCccCceEEcC-CCcccEE
Confidence 5679999999999999999999999999999999543 688899999999999999999999999987 7899999
Q ss_pred EEeeCC-----------------------------------------CCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080 2347 VVWDTL-----------------------------------------APPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2347 rLWD~l-----------------------------------------~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
++||+. .++-+.+..+.||+.+|-.+|-+|+|..+++
T Consensus 371 ~fwn~~~g~~i~~vdtgsQVcsL~Wsk~~kEi~sthG~s~n~i~lw~~ps~~~~~~l~gH~~RVl~la~SPdg~~i~t 448 (484)
T KOG0305|consen 371 KFWNTNTGARIDSVDTGSQVCSLIWSKKYKELLSTHGYSENQITLWKYPSMKLVAELLGHTSRVLYLALSPDGETIVT 448 (484)
T ss_pred EEEEcCCCcEecccccCCceeeEEEcCCCCEEEEecCCCCCcEEEEeccccceeeeecCCcceeEEEEECCCCCEEEE
Confidence 999972 0111234557889999999999999888765
No 61
>KOG0265 consensus U5 snRNP-specific protein-like factor and related proteins [RNA processing and modification]
Probab=99.48 E-value=2e-13 Score=158.34 Aligned_cols=172 Identities=21% Similarity=0.237 Sum_probs=143.6
Q ss_pred cceeeccccccccccccc--cCCCCcCc-eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCC
Q 000080 2194 IGASALGWETQDDFEDYV--DPPATVEN-ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYA 2270 (2389)
Q Consensus 2194 ~~Asg~~~d~~~~~~~~~--d~~atv~n-i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH 2270 (2389)
|..|| ..|.|.++|+.. +...+.++ -.+.+|.|..++..+.||+-|+.|++||++++..+.++. ||
T Consensus 147 lv~Sg-sdD~t~kl~D~R~k~~~~t~~~kyqltAv~f~d~s~qv~sggIdn~ikvWd~r~~d~~~~ls----------Gh 215 (338)
T KOG0265|consen 147 LVCSG-SDDGTLKLWDIRKKEAIKTFENKYQLTAVGFKDTSDQVISGGIDNDIKVWDLRKNDGLYTLS----------GH 215 (338)
T ss_pred EEEec-CCCceEEEEeecccchhhccccceeEEEEEecccccceeeccccCceeeeccccCcceEEee----------cc
Confidence 56677 788888888875 44456654 467999999999999999999999999999999998885 67
Q ss_pred CCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCC----CeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080 2271 LASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSS----HAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus 2271 ~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~----~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
.+.|+.+..||+|.++.|-+.|+||++||++-.. ...+++.-++||.. ....++++| +++.+.+ | |.|+.|
T Consensus 216 ~DtIt~lsls~~gs~llsnsMd~tvrvwd~rp~~-p~~R~v~if~g~~hnfeknlL~cswsp-~~~~i~a-g--s~dr~v 290 (338)
T KOG0265|consen 216 ADTITGLSLSRYGSFLLSNSMDNTVRVWDVRPFA-PSQRCVKIFQGHIHNFEKNLLKCSWSP-NGTKITA-G--SADRFV 290 (338)
T ss_pred cCceeeEEeccCCCccccccccceEEEEEecccC-CCCceEEEeecchhhhhhhcceeeccC-CCCcccc-c--cccceE
Confidence 8999999999999999999999999999998642 22245666677553 334789999 8888865 4 799999
Q ss_pred EEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080 2347 VVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2347 rLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
.+||+. ...++..|.||.+-|.+++++|.-.++||
T Consensus 291 yvwd~~--~r~~lyklpGh~gsvn~~~Fhp~e~iils 325 (338)
T KOG0265|consen 291 YVWDTT--SRRILYKLPGHYGSVNEVDFHPTEPIILS 325 (338)
T ss_pred EEeecc--cccEEEEcCCcceeEEEeeecCCCcEEEE
Confidence 999972 44678999999999999999999999887
No 62
>KOG0306 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.48 E-value=4.9e-13 Score=167.14 Aligned_cols=165 Identities=15% Similarity=0.164 Sum_probs=138.4
Q ss_pred cccccccccccc---cCCCCc------------C-ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCC
Q 000080 2200 GWETQDDFEDYV---DPPATV------------E-NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAA 2263 (2389)
Q Consensus 2200 ~~d~~~~~~~~~---d~~atv------------~-ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh 2263 (2389)
+-|++.++|+|. +.+.|. + .--|-++++||||++||.|=-|.||++|=+.+=+..-++.
T Consensus 473 saDktVkfWdf~l~~~~~gt~~k~lsl~~~rtLel~ddvL~v~~Spdgk~LaVsLLdnTVkVyflDtlKFflsLY----- 547 (888)
T KOG0306|consen 473 SADKTVKFWDFKLVVSVPGTQKKVLSLKHTRTLELEDDVLCVSVSPDGKLLAVSLLDNTVKVYFLDTLKFFLSLY----- 547 (888)
T ss_pred cCCcEEEEEeEEEEeccCcccceeeeeccceEEeccccEEEEEEcCCCcEEEEEeccCeEEEEEecceeeeeeec-----
Confidence 668888888884 322221 1 0146899999999999999999999999998776655542
Q ss_pred CCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCC
Q 000080 2264 NVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNG 2343 (2389)
Q Consensus 2264 ~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D 2343 (2389)
||.=+|.++.+|||++.++|||.|.+||+|-+.=| .+.+++-+|.+.|.+|.|-| .....-|+| .|
T Consensus 548 -----GHkLPV~smDIS~DSklivTgSADKnVKiWGLdFG-----DCHKS~fAHdDSvm~V~F~P-~~~~FFt~g---KD 613 (888)
T KOG0306|consen 548 -----GHKLPVLSMDISPDSKLIVTGSADKNVKIWGLDFG-----DCHKSFFAHDDSVMSVQFLP-KTHLFFTCG---KD 613 (888)
T ss_pred -----ccccceeEEeccCCcCeEEeccCCCceEEeccccc-----hhhhhhhcccCceeEEEEcc-cceeEEEec---Cc
Confidence 57778999999999999999999999999999887 36788889999999999999 667777764 99
Q ss_pred CeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhccc
Q 000080 2344 INVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus 2344 ~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~~ 2385 (2389)
+.||=||- ..-.+++.|.||...|+|+|.+|.|+|.+|--
T Consensus 614 ~kvKqWDg--~kFe~iq~L~~H~~ev~cLav~~~G~~vvs~s 653 (888)
T KOG0306|consen 614 GKVKQWDG--EKFEEIQKLDGHHSEVWCLAVSPNGSFVVSSS 653 (888)
T ss_pred ceEEeech--hhhhhheeeccchheeeeeEEcCCCCeEEecc
Confidence 99999995 24467999999999999999999999999854
No 63
>KOG0274 consensus Cdc4 and related F-box and WD-40 proteins [General function prediction only]
Probab=99.48 E-value=3.1e-13 Score=171.48 Aligned_cols=132 Identities=17% Similarity=0.194 Sum_probs=116.9
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
..|++++|..-+..|+|||.|.|+|+||..+|+|+.++. ||...|+++..-+ ..+.+||.|.|||+||
T Consensus 250 g~V~~l~~~~~~~~lvsgS~D~t~rvWd~~sg~C~~~l~----------gh~stv~~~~~~~--~~~~sgs~D~tVkVW~ 317 (537)
T KOG0274|consen 250 GGVWGLAFPSGGDKLVSGSTDKTERVWDCSTGECTHSLQ----------GHTSSVRCLTIDP--FLLVSGSRDNTVKVWD 317 (537)
T ss_pred CCceeEEEecCCCEEEEEecCCcEEeEecCCCcEEEEec----------CCCceEEEEEccC--ceEeeccCCceEEEEe
Confidence 456999999988899999999999999999999999984 5778888887755 5899999999999999
Q ss_pred CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
++++ ..+.++.||...|++|.++ +.++++| +.|++|++||+ .+++|+++|+||+++|.++.+..
T Consensus 318 v~n~-----~~l~l~~~h~~~V~~v~~~---~~~lvsg---s~d~~v~VW~~--~~~~cl~sl~gH~~~V~sl~~~~ 381 (537)
T KOG0274|consen 318 VTNG-----ACLNLLRGHTGPVNCVQLD---EPLLVSG---SYDGTVKVWDP--RTGKCLKSLSGHTGRVYSLIVDS 381 (537)
T ss_pred ccCc-----ceEEEeccccccEEEEEec---CCEEEEE---ecCceEEEEEh--hhceeeeeecCCcceEEEEEecC
Confidence 9986 4677888899999999998 4788875 68999999998 48999999999999999998776
No 64
>KOG0973 consensus Histone transcription regulator HIRA, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=99.46 E-value=1.1e-12 Score=169.79 Aligned_cols=214 Identities=18% Similarity=0.371 Sum_probs=155.1
Q ss_pred CCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccce--------------eeeeccCCCCCeeEEE
Q 000080 36 APTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFR--------------QVFALSDNSLPVTSIS 101 (2389)
Q Consensus 36 ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~--------------Qviegh~d~~dVk~Va 101 (2389)
.|..+.+-+-|+|| | +.+|.|+.+.+|..|=-++ -..|+.|. -++.+|+. +|..|+
T Consensus 67 ~h~~sv~CVR~S~d--G-~~lAsGSDD~~v~iW~~~~-----~~~~~~fgs~g~~~~vE~wk~~~~l~~H~~--DV~Dv~ 136 (942)
T KOG0973|consen 67 DHDGSVNCVRFSPD--G-SYLASGSDDRLVMIWERAE-----IGSGTVFGSTGGAKNVESWKVVSILRGHDS--DVLDVN 136 (942)
T ss_pred cccCceeEEEECCC--C-CeEeeccCcceEEEeeecc-----cCCcccccccccccccceeeEEEEEecCCC--ccceec
Confidence 46677788889999 8 5999999999999991111 12345552 35566654 999999
Q ss_pred EcCCCCCCCcEEE--ecCCeEEEEeeCCCCCCCCccceeeEEe-cccceEEEEeecCCCCeEEEEecc--eEEeeccCCc
Q 000080 102 WSPETPSIGQLAA--ASENCIFVFAHDSASSKGSFCWSQNAIL-VQGTKVEAIEWTGSGDGIVAGGME--TVLWKKKNTL 176 (2389)
Q Consensus 102 WSPd~~~~GeIaA--SyDntIRVw~~d~~~~kgd~~W~~~~tL-~hssTV~sIAWSpdG~rLaSggdD--V~IW~~~~s~ 176 (2389)
|+|+ +.++| |+||+|-||..- . +.+..++ .|.+-|-.++|+|-|+++||=+|| ++||+. +.
T Consensus 137 Wsp~----~~~lvS~s~DnsViiwn~~------t--F~~~~vl~~H~s~VKGvs~DP~Gky~ASqsdDrtikvwrt--~d 202 (942)
T KOG0973|consen 137 WSPD----DSLLVSVSLDNSVIIWNAK------T--FELLKVLRGHQSLVKGVSWDPIGKYFASQSDDRTLKVWRT--SD 202 (942)
T ss_pred cCCC----ccEEEEecccceEEEEccc------c--ceeeeeeecccccccceEECCccCeeeeecCCceEEEEEc--cc
Confidence 9996 77776 479999999876 2 2455555 499999999999999999999999 999994 44
Q ss_pred EEEEEEeecccc-----ceEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEe
Q 000080 177 WEIAWKFKENYP-----QNLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQW 250 (2389)
Q Consensus 177 Wecvwt~~~~~~-----~~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W 250 (2389)
|.+.-++..... -.+...+|||||. |||.-+... ...++.|.+.+ .-...+-..+|..+|-+|+.
T Consensus 203 w~i~k~It~pf~~~~~~T~f~RlSWSPDG~~las~nA~n~--------~~~~~~IieR~-tWk~~~~LvGH~~p~evvrF 273 (942)
T KOG0973|consen 203 WGIEKSITKPFEESPLTTFFLRLSWSPDGHHLASPNAVNG--------GKSTIAIIERG-TWKVDKDLVGHSAPVEVVRF 273 (942)
T ss_pred ceeeEeeccchhhCCCcceeeecccCCCcCeecchhhccC--------CcceeEEEecC-CceeeeeeecCCCceEEEEe
Confidence 776654321111 1344889999999 998877421 22334444332 22233446789999999999
Q ss_pred ccCCCCC-CCCCCccccCc----eEEeeecCCeEEEEE
Q 000080 251 RPSTRRH-SPGDTKRSQRH----VLLTCCLDGTVRLWC 283 (2389)
Q Consensus 251 ~Ps~~~~-~~~Dgk~~~~n----ILAScSdDgTVRLW~ 283 (2389)
+|. .|. ++.+|+....+ ++|++|.|+++-||.
T Consensus 274 nP~-lfe~~~~ng~~~~~~~~y~i~AvgSqDrSlSVW~ 310 (942)
T KOG0973|consen 274 NPK-LFERNNKNGTSTQPNCYYCIAAVGSQDRSLSVWN 310 (942)
T ss_pred ChH-HhccccccCCccCCCcceEEEEEecCCccEEEEe
Confidence 993 444 55666664454 999999999999999
No 65
>KOG0647 consensus mRNA export protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.45 E-value=7.1e-13 Score=153.90 Aligned_cols=123 Identities=15% Similarity=0.265 Sum_probs=98.5
Q ss_pred eEEEEEEcC-CCCeEEEEeCCCcEEEeecCC-CceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080 2221 STRAFSSHP-LRPFFLVGSSNTHIYLWEFGK-DKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus 2221 ~VrsVAFsP-dG~~LASGS~DgTIRLWDl~t-Gk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
+|.+|+||| ...++++||.|++||+||+.. |..+.+.. .-|.+.|-+|+||-||.++++|+.|+.+|+|
T Consensus 29 sIS~l~FSP~~~~~~~A~SWD~tVR~wevq~~g~~~~ka~---------~~~~~PvL~v~WsddgskVf~g~~Dk~~k~w 99 (347)
T KOG0647|consen 29 SISALAFSPQADNLLAAGSWDGTVRIWEVQNSGQLVPKAQ---------QSHDGPVLDVCWSDDGSKVFSGGCDKQAKLW 99 (347)
T ss_pred chheeEeccccCceEEecccCCceEEEEEecCCcccchhh---------hccCCCeEEEEEccCCceEEeeccCCceEEE
Confidence 348899999 555777999999999999986 45444322 1256889999999999999999999999999
Q ss_pred eCCCCCccCcccceeeeecCCCeeEEEEecCC-CCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080 2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSS-GSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~D-GslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
|+.++ ...+...|.+.|..+.|.++- -+.|||| |.|+|||.||+. ..+.+.+++
T Consensus 100 DL~S~------Q~~~v~~Hd~pvkt~~wv~~~~~~cl~TG---SWDKTlKfWD~R--~~~pv~t~~ 154 (347)
T KOG0647|consen 100 DLASG------QVSQVAAHDAPVKTCHWVPGMNYQCLVTG---SWDKTLKFWDTR--SSNPVATLQ 154 (347)
T ss_pred EccCC------CeeeeeecccceeEEEEecCCCcceeEec---ccccceeecccC--CCCeeeeee
Confidence 99986 256677899999999999832 2378885 799999999995 334555554
No 66
>KOG0313 consensus Microtubule binding protein YTM1 (contains WD40 repeats) [Cytoskeleton]
Probab=99.45 E-value=5.3e-13 Score=158.16 Aligned_cols=169 Identities=14% Similarity=0.139 Sum_probs=136.6
Q ss_pred cccccceeeccccccccccccc-cCCCCcC--------------------------c--eeEEEEEEcCCCCeEEEEeCC
Q 000080 2190 GYAGIGASALGWETQDDFEDYV-DPPATVE--------------------------N--ISTRAFSSHPLRPFFLVGSSN 2240 (2389)
Q Consensus 2190 g~~~~~Asg~~~d~~~~~~~~~-d~~atv~--------------------------n--i~VrsVAFsPdG~~LASGS~D 2240 (2389)
++..+.+|| +||++..+|.+. ++..+++ + -+|.+|-|++ ...+.|+|+|
T Consensus 203 ~sgtr~~Sg-S~D~~lkiWs~~~~~~~~~E~~s~~rrk~~~~~~~~~~r~P~vtl~GHt~~Vs~V~w~d-~~v~yS~SwD 280 (423)
T KOG0313|consen 203 SSGTRFCSG-SWDTMLKIWSVETDEEDELESSSNRRRKKQKREKEGGTRTPLVTLEGHTEPVSSVVWSD-ATVIYSVSWD 280 (423)
T ss_pred CCCCeEEee-cccceeeecccCCCccccccccchhhhhhhhhhhcccccCceEEecccccceeeEEEcC-CCceEeeccc
Confidence 345567888 999999999842 1111111 1 2789999999 6678999999
Q ss_pred CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCC
Q 000080 2241 THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSH 2320 (2389)
Q Consensus 2241 gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~ 2320 (2389)
.|||.||+.+|+++.++.. .....+|..+|.-++||+||.|..+||||.++++ ..-+..++.||.+.
T Consensus 281 HTIk~WDletg~~~~~~~~-----------~ksl~~i~~~~~~~Ll~~gssdr~irl~DPR~~~--gs~v~~s~~gH~nw 347 (423)
T KOG0313|consen 281 HTIKVWDLETGGLKSTLTT-----------NKSLNCISYSPLSKLLASGSSDRHIRLWDPRTGD--GSVVSQSLIGHKNW 347 (423)
T ss_pred ceEEEEEeecccceeeeec-----------CcceeEeecccccceeeecCCCCceeecCCCCCC--CceeEEeeecchhh
Confidence 9999999999999888741 2568999999999999999999999999999974 33466889999999
Q ss_pred eeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080 2321 AMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus 2321 V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
|.+|-++|-+-..++|+ |.|+|+||||+. .+...+..+.+|...|-++.-.+.
T Consensus 348 Vssvkwsp~~~~~~~S~---S~D~t~klWDvR-S~k~plydI~~h~DKvl~vdW~~~ 400 (423)
T KOG0313|consen 348 VSSVKWSPTNEFQLVSG---SYDNTVKLWDVR-STKAPLYDIAGHNDKVLSVDWNEG 400 (423)
T ss_pred hhheecCCCCceEEEEE---ecCCeEEEEEec-cCCCcceeeccCCceEEEEeccCC
Confidence 99999999666677775 799999999995 344469999999999988876554
No 67
>KOG0282 consensus mRNA splicing factor [Function unknown]
Probab=99.45 E-value=1.3e-13 Score=166.66 Aligned_cols=173 Identities=13% Similarity=0.209 Sum_probs=135.9
Q ss_pred ccccccceeeccccccccccccccCCCCcC-----ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCC
Q 000080 2189 PGYAGIGASALGWETQDDFEDYVDPPATVE-----NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAA 2263 (2389)
Q Consensus 2189 ~g~~~~~Asg~~~d~~~~~~~~~d~~atv~-----ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh 2263 (2389)
|=..-+++|+ |-|....+|++.+.-..+. +-+|++++|+++|..++|+|.|++|||||+++|+++..|.. +
T Consensus 224 p~~~hLlLS~-gmD~~vklW~vy~~~~~lrtf~gH~k~Vrd~~~s~~g~~fLS~sfD~~lKlwDtETG~~~~~f~~--~- 299 (503)
T KOG0282|consen 224 PKKGHLLLSG-GMDGLVKLWNVYDDRRCLRTFKGHRKPVRDASFNNCGTSFLSASFDRFLKLWDTETGQVLSRFHL--D- 299 (503)
T ss_pred cceeeEEEec-CCCceEEEEEEecCcceehhhhcchhhhhhhhccccCCeeeeeecceeeeeeccccceEEEEEec--C-
Confidence 4455667788 8888889998875323322 34779999999999999999999999999999999999851 1
Q ss_pred CCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCC
Q 000080 2264 NVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSN 2342 (2389)
Q Consensus 2264 ~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~ 2342 (2389)
..+++|.|.||+ +.|.+|+.|+.|+.||++++ +.+..+..|-+.|.++.|.+ +|+..+|+ |+
T Consensus 300 --------~~~~cvkf~pd~~n~fl~G~sd~ki~~wDiRs~-----kvvqeYd~hLg~i~~i~F~~-~g~rFiss---SD 362 (503)
T KOG0282|consen 300 --------KVPTCVKFHPDNQNIFLVGGSDKKIRQWDIRSG-----KVVQEYDRHLGAILDITFVD-EGRRFISS---SD 362 (503)
T ss_pred --------CCceeeecCCCCCcEEEEecCCCcEEEEeccch-----HHHHHHHhhhhheeeeEEcc-CCceEeee---cc
Confidence 457999999999 99999999999999999987 46677778999999999999 88999986 79
Q ss_pred CCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080 2343 GINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2343 D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
|++||||+...+ ...-....-+..-..|++.+|.|+|..-
T Consensus 363 dks~riWe~~~~-v~ik~i~~~~~hsmP~~~~~P~~~~~~a 402 (503)
T KOG0282|consen 363 DKSVRIWENRIP-VPIKNIADPEMHTMPCLTLHPNGKWFAA 402 (503)
T ss_pred CccEEEEEcCCC-ccchhhcchhhccCcceecCCCCCeehh
Confidence 999999997322 1111112222223668888888887653
No 68
>KOG0302 consensus Ribosome Assembly protein [General function prediction only]
Probab=99.45 E-value=7.7e-13 Score=156.63 Aligned_cols=158 Identities=22% Similarity=0.325 Sum_probs=117.5
Q ss_pred cccCCCccccCccccccccccccceeeccccccccccccccCCCCcCceeEEEEEEcCCCC-eEEEEeCCCcEEEeecCC
Q 000080 2172 SLARPGRDLTGGLAFGIPGYAGIGASALGWETQDDFEDYVDPPATVENISTRAFSSHPLRP-FFLVGSSNTHIYLWEFGK 2250 (2389)
Q Consensus 2172 ~~~~~~~~~~~~~~~~~~g~~~~~Asg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~-~LASGS~DgTIRLWDl~t 2250 (2389)
|+.+.++-++|--.++| +-|+-..--|.+...+-+.+.-+|-.+.|||+-. .|||+|.||+|||||++.
T Consensus 220 Sp~~~g~LlsGDc~~~I----------~lw~~~~g~W~vd~~Pf~gH~~SVEDLqWSptE~~vfaScS~DgsIrIWDiRs 289 (440)
T KOG0302|consen 220 SPIKTGRLLSGDCVKGI----------HLWEPSTGSWKVDQRPFTGHTKSVEDLQWSPTEDGVFASCSCDGSIRIWDIRS 289 (440)
T ss_pred ccccccccccCccccce----------EeeeeccCceeecCccccccccchhhhccCCccCceEEeeecCceEEEEEecC
Confidence 44455555554444443 2344444445443333344445667889999865 799999999999999998
Q ss_pred CceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCC
Q 000080 2251 DKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSS 2330 (2389)
Q Consensus 2251 Gk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~D 2330 (2389)
+....++.. .+ |.+.|+.|.||-+-.+||||++|||++|||+++-. .-+|+.++.-|..+|++|.|+|.+
T Consensus 290 ~~~~~~~~~-kA-------h~sDVNVISWnr~~~lLasG~DdGt~~iwDLR~~~--~~~pVA~fk~Hk~pItsieW~p~e 359 (440)
T KOG0302|consen 290 GPKKAAVST-KA-------HNSDVNVISWNRREPLLASGGDDGTLSIWDLRQFK--SGQPVATFKYHKAPITSIEWHPHE 359 (440)
T ss_pred CCccceeEe-ec-------cCCceeeEEccCCcceeeecCCCceEEEEEhhhcc--CCCcceeEEeccCCeeEEEecccc
Confidence 843333221 34 45789999999887899999999999999999852 227889999999999999999988
Q ss_pred CCEEEEeecCCCCCeEEEeeCC
Q 000080 2331 GSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2331 GslLASAG~sS~D~TVrLWD~l 2352 (2389)
.+.||++ ++|.+|.|||+.
T Consensus 360 ~s~iaas---g~D~QitiWDls 378 (440)
T KOG0302|consen 360 DSVIAAS---GEDNQITIWDLS 378 (440)
T ss_pred CceEEec---cCCCcEEEEEee
Confidence 8888876 489999999983
No 69
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.44 E-value=3.6e-13 Score=163.29 Aligned_cols=142 Identities=13% Similarity=0.127 Sum_probs=120.5
Q ss_pred EEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeC
Q 000080 2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl 2300 (2389)
|.+++|-.||++||.|...|.|+++|..+-..++.++ +|+++|..+.|+|++ ..|++||+|+.+++||+
T Consensus 71 v~s~~fR~DG~LlaaGD~sG~V~vfD~k~r~iLR~~~----------ah~apv~~~~f~~~d~t~l~s~sDd~v~k~~d~ 140 (487)
T KOG0310|consen 71 VYSVDFRSDGRLLAAGDESGHVKVFDMKSRVILRQLY----------AHQAPVHVTKFSPQDNTMLVSGSDDKVVKYWDL 140 (487)
T ss_pred eeEEEeecCCeEEEccCCcCcEEEeccccHHHHHHHh----------hccCceeEEEecccCCeEEEecCCCceEEEEEc
Confidence 3888999999999999999999999965534566664 367889999999986 68889999999999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
.++ .....+++|++.|++.+++|.++.+++|| |-|++||+||+...+ ..+.+|. |..+|-++-+.|.|-.
T Consensus 141 s~a-----~v~~~l~~htDYVR~g~~~~~~~hivvtG---sYDg~vrl~DtR~~~-~~v~eln-hg~pVe~vl~lpsgs~ 210 (487)
T KOG0310|consen 141 STA-----YVQAELSGHTDYVRCGDISPANDHIVVTG---SYDGKVRLWDTRSLT-SRVVELN-HGCPVESVLALPSGSL 210 (487)
T ss_pred CCc-----EEEEEecCCcceeEeeccccCCCeEEEec---CCCceEEEEEeccCC-ceeEEec-CCCceeeEEEcCCCCE
Confidence 986 23568899999999999999888899996 589999999996433 5577777 8999999999999876
Q ss_pred hhc
Q 000080 2381 ALS 2383 (2389)
Q Consensus 2381 ~~s 2383 (2389)
+.|
T Consensus 211 ias 213 (487)
T KOG0310|consen 211 IAS 213 (487)
T ss_pred EEE
Confidence 655
No 70
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=99.43 E-value=8.3e-13 Score=160.21 Aligned_cols=182 Identities=14% Similarity=0.124 Sum_probs=139.0
Q ss_pred cceeeccccccccccccccCCCCcC---------ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCC
Q 000080 2194 IGASALGWETQDDFEDYVDPPATVE---------NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAAN 2264 (2389)
Q Consensus 2194 ~~Asg~~~d~~~~~~~~~d~~atv~---------ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~ 2264 (2389)
..++| ++|-+.++|+|....++.. +-.|++++|+|+|..|+..|....++|.|- .|..+..+. .|..
T Consensus 181 R~~sG-s~Dy~v~~wDf~gMdas~~~fr~l~P~E~h~i~sl~ys~Tg~~iLvvsg~aqakl~DR-dG~~~~e~~--KGDQ 256 (641)
T KOG0772|consen 181 RFVSG-SLDYTVKFWDFQGMDASMRSFRQLQPCETHQINSLQYSVTGDQILVVSGSAQAKLLDR-DGFEIVEFS--KGDQ 256 (641)
T ss_pred eeeec-cccceEEEEecccccccchhhhccCcccccccceeeecCCCCeEEEEecCcceeEEcc-CCceeeeee--ccch
Confidence 45788 9999999999974444322 236799999999999998899999999994 676554331 2333
Q ss_pred C-----CCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCCCccCcccceee--eecCCCeeEEEEecCCCCEEEE
Q 000080 2265 V-----PPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEVGGRSNVRPMESC--LCFSSHAMDVSYITSSGSVIAA 2336 (2389)
Q Consensus 2265 ~-----p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tggrs~~k~l~tl--~gHs~~V~sVAFSP~DGslLAS 2336 (2389)
+ -.-||.+.+++..|.|+. ..|.|+|.|||+||||++.. +++.+.+.+- .|-.-.+.+.+|+| ||.+||+
T Consensus 257 YI~Dm~nTKGHia~lt~g~whP~~k~~FlT~s~DgtlRiWdv~~~-k~q~qVik~k~~~g~Rv~~tsC~~nr-dg~~iAa 334 (641)
T KOG0772|consen 257 YIRDMYNTKGHIAELTCGCWHPDNKEEFLTCSYDGTLRIWDVNNT-KSQLQVIKTKPAGGKRVPVTSCAWNR-DGKLIAA 334 (641)
T ss_pred hhhhhhccCCceeeeeccccccCcccceEEecCCCcEEEEecCCc-hhheeEEeeccCCCcccCceeeecCC-Ccchhhh
Confidence 1 256899999999999997 69999999999999999875 3343444332 23334567899999 9999997
Q ss_pred eecCCCCCeEEEeeCCCCCCCceEE-EEeecC--cEEEEeecccchhhhcc
Q 000080 2337 AGHSSNGINVVVWDTLAPPTSSRAS-ITCHEG--LYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2337 AG~sS~D~TVrLWD~l~~tg~~v~s-L~GH~~--~V~svA~~~~~~~~~s~ 2384 (2389)
| ..||.|++||....+...... =+.|.. .|+||+||.+||..||.
T Consensus 335 g---c~DGSIQ~W~~~~~~v~p~~~vk~AH~~g~~Itsi~FS~dg~~LlSR 382 (641)
T KOG0772|consen 335 G---CLDGSIQIWDKGSRTVRPVMKVKDAHLPGQDITSISFSYDGNYLLSR 382 (641)
T ss_pred c---ccCCceeeeecCCcccccceEeeeccCCCCceeEEEeccccchhhhc
Confidence 4 699999999974333333333 367888 99999999999999985
No 71
>KOG0277 consensus Peroxisomal targeting signal type 2 receptor [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.43 E-value=1.3e-12 Score=149.14 Aligned_cols=141 Identities=13% Similarity=0.165 Sum_probs=118.2
Q ss_pred EEEEEEcCCCC-eEEEEeCCCcEEEeecCCC-ceeeEecccCCCCCCCCCCCCCEEEEEECCC-CCEEEEEeCCCcEEEe
Q 000080 2222 TRAFSSHPLRP-FFLVGSSNTHIYLWEFGKD-KATATYGVLPAANVPPPYALASISALQFDHY-GHRFASAALDGTVCTW 2298 (2389)
Q Consensus 2222 VrsVAFsPdG~-~LASGS~DgTIRLWDl~tG-k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~DgTVkLW 2298 (2389)
+..|+|+++-. .+++++.||++||||.... ..++.|+ -|...|.+|-.++- ++.+.++|.|+|||||
T Consensus 63 LfdV~Wse~~e~~~~~a~GDGSLrl~d~~~~s~Pi~~~k----------EH~~EV~Svdwn~~~r~~~ltsSWD~TiKLW 132 (311)
T KOG0277|consen 63 LFDVAWSENHENQVIAASGDGSLRLFDLTMPSKPIHKFK----------EHKREVYSVDWNTVRRRIFLTSSWDGTIKLW 132 (311)
T ss_pred eeEeeecCCCcceEEEEecCceEEEeccCCCCcchhHHH----------hhhhheEEeccccccceeEEeeccCCceEee
Confidence 37889999854 7889999999999996544 3667775 26799999999986 5778888999999999
Q ss_pred eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080 2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
+.+.+ +-++|+.||...|+.++|+|..+.++|++ |.|++.||||+..+ |+.+. +..|...|.|...+|--
T Consensus 133 ~~~r~-----~Sv~Tf~gh~~~Iy~a~~sp~~~nlfas~---Sgd~~l~lwdvr~~-gk~~~-i~ah~~Eil~cdw~ky~ 202 (311)
T KOG0277|consen 133 DPNRP-----NSVQTFNGHNSCIYQAAFSPHIPNLFASA---SGDGTLRLWDVRSP-GKFMS-IEAHNSEILCCDWSKYN 202 (311)
T ss_pred cCCCC-----cceEeecCCccEEEEEecCCCCCCeEEEc---cCCceEEEEEecCC-CceeE-EEeccceeEeecccccC
Confidence 99865 46889999999999999999999999997 68999999998644 65544 89999999999888866
Q ss_pred hhhh
Q 000080 2379 NFAL 2382 (2389)
Q Consensus 2379 ~~~~ 2382 (2389)
+..|
T Consensus 203 ~~vl 206 (311)
T KOG0277|consen 203 HNVL 206 (311)
T ss_pred CcEE
Confidence 5544
No 72
>KOG0973 consensus Histone transcription regulator HIRA, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=99.43 E-value=8.5e-13 Score=170.80 Aligned_cols=143 Identities=17% Similarity=0.154 Sum_probs=119.9
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCC-------Cc-----------eeeEecccCCCCCCCCCCCCCEEEEEECC
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGK-------DK-----------ATATYGVLPAANVPPPYALASISALQFDH 2281 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~t-------Gk-----------~l~Tl~vl~gh~~p~~GH~~~V~sVaFSP 2281 (2389)
..|.+|-|+|||++||+||+|+.|.+|+... |. ++.+|+ ||.+.|..|+++|
T Consensus 70 ~sv~CVR~S~dG~~lAsGSDD~~v~iW~~~~~~~~~~fgs~g~~~~vE~wk~~~~l~----------~H~~DV~Dv~Wsp 139 (942)
T KOG0973|consen 70 GSVNCVRFSPDGSYLASGSDDRLVMIWERAEIGSGTVFGSTGGAKNVESWKVVSILR----------GHDSDVLDVNWSP 139 (942)
T ss_pred CceeEEEECCCCCeEeeccCcceEEEeeecccCCcccccccccccccceeeEEEEEe----------cCCCccceeccCC
Confidence 3678999999999999999999999999762 11 233443 6789999999999
Q ss_pred CCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEE
Q 000080 2282 YGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRAS 2361 (2389)
Q Consensus 2282 DG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~s 2361 (2389)
||.+|||+|.|++|-+||..+. +.+..+.+|++.|-.|+|.| -|+++||- |+|+||++|++. .-++.++
T Consensus 140 ~~~~lvS~s~DnsViiwn~~tF-----~~~~vl~~H~s~VKGvs~DP-~Gky~ASq---sdDrtikvwrt~--dw~i~k~ 208 (942)
T KOG0973|consen 140 DDSLLVSVSLDNSVIIWNAKTF-----ELLKVLRGHQSLVKGVSWDP-IGKYFASQ---SDDRTLKVWRTS--DWGIEKS 208 (942)
T ss_pred CccEEEEecccceEEEEccccc-----eeeeeeecccccccceEECC-ccCeeeee---cCCceEEEEEcc--cceeeEe
Confidence 9999999999999999999987 46788999999999999999 99999996 699999999973 3445677
Q ss_pred EEeecC------cEEEEeecccchhhhc
Q 000080 2362 ITCHEG------LYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2362 L~GH~~------~V~svA~~~~~~~~~s 2383 (2389)
+.++.+ -+.-++=||||.++.|
T Consensus 209 It~pf~~~~~~T~f~RlSWSPDG~~las 236 (942)
T KOG0973|consen 209 ITKPFEESPLTTFFLRLSWSPDGHHLAS 236 (942)
T ss_pred eccchhhCCCcceeeecccCCCcCeecc
Confidence 766554 3457888899888765
No 73
>KOG0282 consensus mRNA splicing factor [Function unknown]
Probab=99.42 E-value=7.8e-14 Score=168.65 Aligned_cols=141 Identities=16% Similarity=0.235 Sum_probs=119.8
Q ss_pred eEEEEEEcC-CCCeEEEEeCCCcEEEeecCC-CceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080 2221 STRAFSSHP-LRPFFLVGSSNTHIYLWEFGK-DKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus 2221 ~VrsVAFsP-dG~~LASGS~DgTIRLWDl~t-Gk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
.|.++.|.| .+.+|+|||-|+.|+|||+.. ++|++||. ||...|++++||++|..|.|+|-|++||||
T Consensus 216 gvsai~~fp~~~hLlLS~gmD~~vklW~vy~~~~~lrtf~----------gH~k~Vrd~~~s~~g~~fLS~sfD~~lKlw 285 (503)
T KOG0282|consen 216 GVSAIQWFPKKGHLLLSGGMDGLVKLWNVYDDRRCLRTFK----------GHRKPVRDASFNNCGTSFLSASFDRFLKLW 285 (503)
T ss_pred ccchhhhccceeeEEEecCCCceEEEEEEecCcceehhhh----------cchhhhhhhhccccCCeeeeeecceeeeee
Confidence 458889999 899999999999999999876 78999995 577899999999999999999999999999
Q ss_pred eCCCCCccCcccceeeeecCC-CeeEEEEecCCC-CEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080 2299 QLEVGGRSNVRPMESCLCFSS-HAMDVSYITSSG-SVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~tl~gHs~-~V~sVAFSP~DG-slLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
|++||. +...+ |.+ .+++|-|.| |+ +.+.+|| .|+.|+.||+ .+++.+|...-|-+.|..+.|-+
T Consensus 286 DtETG~-----~~~~f--~~~~~~~cvkf~p-d~~n~fl~G~---sd~ki~~wDi--Rs~kvvqeYd~hLg~i~~i~F~~ 352 (503)
T KOG0282|consen 286 DTETGQ-----VLSRF--HLDKVPTCVKFHP-DNQNIFLVGG---SDKKIRQWDI--RSGKVVQEYDRHLGAILDITFVD 352 (503)
T ss_pred ccccce-----EEEEE--ecCCCceeeecCC-CCCcEEEEec---CCCcEEEEec--cchHHHHHHHhhhhheeeeEEcc
Confidence 999983 33333 443 456899999 55 6666653 7899999998 46788999999999999999999
Q ss_pred cchhhhcc
Q 000080 2377 LLNFALSK 2384 (2389)
Q Consensus 2377 ~~~~~~s~ 2384 (2389)
.|++-+|.
T Consensus 353 ~g~rFiss 360 (503)
T KOG0282|consen 353 EGRRFISS 360 (503)
T ss_pred CCceEeee
Confidence 99876653
No 74
>KOG0647 consensus mRNA export protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.42 E-value=1.5e-12 Score=151.20 Aligned_cols=186 Identities=12% Similarity=0.160 Sum_probs=144.0
Q ss_pred CCccccCccccccccccccceeeccccccccccccccCCCCc------CceeEEEEEEcCCCCeEEEEeCCCcEEEeecC
Q 000080 2176 PGRDLTGGLAFGIPGYAGIGASALGWETQDDFEDYVDPPATV------ENISTRAFSSHPLRPFFLVGSSNTHIYLWEFG 2249 (2389)
Q Consensus 2176 ~~~~~~~~~~~~~~g~~~~~Asg~~~d~~~~~~~~~d~~atv------~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~ 2249 (2389)
|+.++....+|+- -.+.|+|.| +||.+.|.|++.+.-..+ .+-+|-+++|+-||..+++|+.|+.+++||+.
T Consensus 25 pP~DsIS~l~FSP-~~~~~~~A~-SWD~tVR~wevq~~g~~~~ka~~~~~~PvL~v~WsddgskVf~g~~Dk~~k~wDL~ 102 (347)
T KOG0647|consen 25 PPEDSISALAFSP-QADNLLAAG-SWDGTVRIWEVQNSGQLVPKAQQSHDGPVLDVCWSDDGSKVFSGGCDKQAKLWDLA 102 (347)
T ss_pred CcccchheeEecc-ccCceEEec-ccCCceEEEEEecCCcccchhhhccCCCeEEEEEccCCceEEeeccCCceEEEEcc
Confidence 3444446677764 556677778 999999999997531221 12478999999999999999999999999999
Q ss_pred CCceeeEecccCCCCCCCCCCCCCEEEEEECCCCC--EEEEEeCCCcEEEeeCCCCC---------c-------------
Q 000080 2250 KDKATATYGVLPAANVPPPYALASISALQFDHYGH--RFASAALDGTVCTWQLEVGG---------R------------- 2305 (2389)
Q Consensus 2250 tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~--~LASgS~DgTVkLWDl~tgg---------r------------- 2305 (2389)
+|+..+.- .|.+.|+.+.|-+... .|++||+|.|||.||.+... |
T Consensus 103 S~Q~~~v~-----------~Hd~pvkt~~wv~~~~~~cl~TGSWDKTlKfWD~R~~~pv~t~~LPeRvYa~Dv~~pm~vV 171 (347)
T KOG0647|consen 103 SGQVSQVA-----------AHDAPVKTCHWVPGMNYQCLVTGSWDKTLKFWDTRSSNPVATLQLPERVYAADVLYPMAVV 171 (347)
T ss_pred CCCeeeee-----------ecccceeEEEEecCCCcceeEecccccceeecccCCCCeeeeeeccceeeehhccCceeEE
Confidence 99654432 2678899999987776 99999999999999997641 1
Q ss_pred ----------------------------------------------------------cCcccceeeeecC---------
Q 000080 2306 ----------------------------------------------------------SNVRPMESCLCFS--------- 2318 (2389)
Q Consensus 2306 ----------------------------------------------------------s~~k~l~tl~gHs--------- 2318 (2389)
.+++.-+++.||.
T Consensus 172 ata~r~i~vynL~n~~te~k~~~SpLk~Q~R~va~f~d~~~~alGsiEGrv~iq~id~~~~~~nFtFkCHR~~~~~~~~V 251 (347)
T KOG0647|consen 172 ATAERHIAVYNLENPPTEFKRIESPLKWQTRCVACFQDKDGFALGSIEGRVAIQYIDDPNPKDNFTFKCHRSTNSVNDDV 251 (347)
T ss_pred EecCCcEEEEEcCCCcchhhhhcCcccceeeEEEEEecCCceEeeeecceEEEEecCCCCccCceeEEEeccCCCCCCce
Confidence 0224456778887
Q ss_pred CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080 2319 SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus 2319 ~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
+.|++|+|+| .-..|||+| .||+...||- .....+.+-+-|...|+|-++..+|..
T Consensus 252 YaVNsi~FhP-~hgtlvTaG---sDGtf~FWDk--dar~kLk~s~~~~qpItcc~fn~~G~i 307 (347)
T KOG0647|consen 252 YAVNSIAFHP-VHGTLVTAG---SDGTFSFWDK--DARTKLKTSETHPQPITCCSFNRNGSI 307 (347)
T ss_pred EEecceEeec-ccceEEEec---CCceEEEecc--hhhhhhhccCcCCCccceeEecCCCCE
Confidence 3577999999 567788997 7999999995 223346777789999999999999974
No 75
>KOG0274 consensus Cdc4 and related F-box and WD-40 proteins [General function prediction only]
Probab=99.42 E-value=6.2e-13 Score=168.83 Aligned_cols=156 Identities=16% Similarity=0.243 Sum_probs=127.3
Q ss_pred cccceeeccccccccccccccCCCC--cC--ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCC
Q 000080 2192 AGIGASALGWETQDDFEDYVDPPAT--VE--NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPP 2267 (2389)
Q Consensus 2192 ~~~~Asg~~~d~~~~~~~~~d~~at--v~--ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~ 2267 (2389)
++.+.+| +.|.++++|+.....-+ +. .-.|+.+.. .+..+++||.|.|||+||+.+|+++.+++
T Consensus 261 ~~~lvsg-S~D~t~rvWd~~sg~C~~~l~gh~stv~~~~~--~~~~~~sgs~D~tVkVW~v~n~~~l~l~~--------- 328 (537)
T KOG0274|consen 261 GDKLVSG-STDKTERVWDCSTGECTHSLQGHTSSVRCLTI--DPFLLVSGSRDNTVKVWDVTNGACLNLLR--------- 328 (537)
T ss_pred CCEEEEE-ecCCcEEeEecCCCcEEEEecCCCceEEEEEc--cCceEeeccCCceEEEEeccCcceEEEec---------
Confidence 5667888 88999999986432111 11 113344444 44568999999999999999999999985
Q ss_pred CCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080 2268 PYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus 2268 ~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
||.+.|++|+++ +..+.+|+.|++|++||++++ +++.+++||+..|+++.+.+ . ..+.+| |.|++||
T Consensus 329 -~h~~~V~~v~~~--~~~lvsgs~d~~v~VW~~~~~-----~cl~sl~gH~~~V~sl~~~~-~-~~~~Sg---s~D~~Ik 395 (537)
T KOG0274|consen 329 -GHTGPVNCVQLD--EPLLVSGSYDGTVKVWDPRTG-----KCLKSLSGHTGRVYSLIVDS-E-NRLLSG---SLDTTIK 395 (537)
T ss_pred -cccccEEEEEec--CCEEEEEecCceEEEEEhhhc-----eeeeeecCCcceEEEEEecC-c-ceEEee---eeccceE
Confidence 477999999999 889999999999999999986 68999999999999998876 3 788886 6899999
Q ss_pred EeeCCCCCC-CceEEEEeecCcEEEEee
Q 000080 2348 VWDTLAPPT-SSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus 2348 LWD~l~~tg-~~v~sL~GH~~~V~svA~ 2374 (2389)
+||+ .+. +|+++|.+|+.-|.++..
T Consensus 396 vWdl--~~~~~c~~tl~~h~~~v~~l~~ 421 (537)
T KOG0274|consen 396 VWDL--RTKRKCIHTLQGHTSLVSSLLL 421 (537)
T ss_pred eecC--CchhhhhhhhcCCccccccccc
Confidence 9998 455 799999999999876654
No 76
>KOG0308 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.42 E-value=3.4e-13 Score=166.89 Aligned_cols=169 Identities=18% Similarity=0.224 Sum_probs=134.2
Q ss_pred cccccccccccccC-CCCcC--ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCC--ceeeEecccCCCCCCCCCCCCCE
Q 000080 2200 GWETQDDFEDYVDP-PATVE--NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKD--KATATYGVLPAANVPPPYALASI 2274 (2389)
Q Consensus 2200 ~~d~~~~~~~~~d~-~atv~--ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tG--k~l~Tl~vl~gh~~p~~GH~~~V 2274 (2389)
.|+..++...+.++ .++++ +-.|..++..-+|+.|+|+|.|.||++|+...+ .|+.|++ -|.++|
T Consensus 51 ~W~~~~d~~~~s~~~~asme~HsDWVNDiiL~~~~~tlIS~SsDtTVK~W~~~~~~~~c~stir----------~H~DYV 120 (735)
T KOG0308|consen 51 LWSVTQDSNEPSTPYIASMEHHSDWVNDIILCGNGKTLISASSDTTVKVWNAHKDNTFCMSTIR----------THKDYV 120 (735)
T ss_pred EeccccccCCcccchhhhhhhhHhHHhhHHhhcCCCceEEecCCceEEEeecccCcchhHhhhh----------cccchh
Confidence 45555555544333 22222 123466788888999999999999999999877 6888885 278999
Q ss_pred EEEEE-CCCCCEEEEEeCCCcEEEeeCCCCCc-----cCcccceeee-ecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080 2275 SALQF-DHYGHRFASAALDGTVCTWQLEVGGR-----SNVRPMESCL-CFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus 2275 ~sVaF-SPDG~~LASgS~DgTVkLWDl~tggr-----s~~k~l~tl~-gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
.++++ -++...+|||+.|+.|.|||+++|.. .+..+..++. ||-..|+++|-++ .|..|++|| -.+-+|
T Consensus 121 kcla~~ak~~~lvaSgGLD~~IflWDin~~~~~l~~s~n~~t~~sl~sG~k~siYSLA~N~-t~t~ivsGg---tek~lr 196 (735)
T KOG0308|consen 121 KCLAYIAKNNELVASGGLDRKIFLWDINTGTATLVASFNNVTVNSLGSGPKDSIYSLAMNQ-TGTIIVSGG---TEKDLR 196 (735)
T ss_pred eeeeecccCceeEEecCCCccEEEEEccCcchhhhhhccccccccCCCCCccceeeeecCC-cceEEEecC---cccceE
Confidence 99999 89999999999999999999998721 1222333444 8899999999999 999999874 678999
Q ss_pred EeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080 2348 VWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2348 LWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
+||. .+.+.+..|+||+..|+++-.+.+|+++||.
T Consensus 197 ~wDp--rt~~kimkLrGHTdNVr~ll~~dDGt~~ls~ 231 (735)
T KOG0308|consen 197 LWDP--RTCKKIMKLRGHTDNVRVLLVNDDGTRLLSA 231 (735)
T ss_pred Eecc--ccccceeeeeccccceEEEEEcCCCCeEeec
Confidence 9997 3666789999999999999999999998874
No 77
>KOG0640 consensus mRNA cleavage stimulating factor complex; subunit 1 [RNA processing and modification]
Probab=99.41 E-value=2.8e-13 Score=156.88 Aligned_cols=148 Identities=18% Similarity=0.267 Sum_probs=120.7
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.|..+.|||...+|+|||.|+||||+|+.+....+.++++.+ ...|+++.|.|.|.+|+.|.+-.++||+|+
T Consensus 174 evn~l~FHPre~ILiS~srD~tvKlFDfsK~saKrA~K~~qd--------~~~vrsiSfHPsGefllvgTdHp~~rlYdv 245 (430)
T KOG0640|consen 174 EVNDLDFHPRETILISGSRDNTVKLFDFSKTSAKRAFKVFQD--------TEPVRSISFHPSGEFLLVGTDHPTLRLYDV 245 (430)
T ss_pred cccceeecchhheEEeccCCCeEEEEecccHHHHHHHHHhhc--------cceeeeEeecCCCceEEEecCCCceeEEec
Confidence 457789999999999999999999999986655555544332 256999999999999999999999999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEE-EeecC-cEEEEeecccc
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASI-TCHEG-LYDLFLPLKLL 2378 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL-~GH~~-~V~svA~~~~~ 2378 (2389)
+|.. +-.+--.-.+|++.|.+|.|++ +|++.+|| |.||.|||||-. .++|+.++ ..|.+ .|.+.-+.+.|
T Consensus 246 ~T~Q--cfvsanPd~qht~ai~~V~Ys~-t~~lYvTa---SkDG~IklwDGV--S~rCv~t~~~AH~gsevcSa~Ftkn~ 317 (430)
T KOG0640|consen 246 NTYQ--CFVSANPDDQHTGAITQVRYSS-TGSLYVTA---SKDGAIKLWDGV--SNRCVRTIGNAHGGSEVCSAVFTKNG 317 (430)
T ss_pred ccee--EeeecCcccccccceeEEEecC-CccEEEEe---ccCCcEEeeccc--cHHHHHHHHhhcCCceeeeEEEccCC
Confidence 9962 1111123467999999999999 99999997 799999999964 57898888 44654 46678889999
Q ss_pred hhhhcc
Q 000080 2379 NFALSK 2384 (2389)
Q Consensus 2379 ~~~~s~ 2384 (2389)
+++||.
T Consensus 318 kyiLsS 323 (430)
T KOG0640|consen 318 KYILSS 323 (430)
T ss_pred eEEeec
Confidence 999984
No 78
>KOG0313 consensus Microtubule binding protein YTM1 (contains WD40 repeats) [Cytoskeleton]
Probab=99.40 E-value=1.5e-12 Score=154.47 Aligned_cols=176 Identities=18% Similarity=0.204 Sum_probs=129.8
Q ss_pred cceeeccccccccccccccCCCCcC--------ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEec-------
Q 000080 2194 IGASALGWETQDDFEDYVDPPATVE--------NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYG------- 2258 (2389)
Q Consensus 2194 ~~Asg~~~d~~~~~~~~~d~~atv~--------ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~------- 2258 (2389)
..+++ +-|-+.++|.+......+. --+|-+|+..++|..++|||.|.+|+||+..+... .++.
T Consensus 161 ~fvsa-s~Dqtl~Lw~~~~~~~~~~~~~~~~GHk~~V~sVsv~~sgtr~~SgS~D~~lkiWs~~~~~~-~~~E~~s~~rr 238 (423)
T KOG0313|consen 161 LFVSA-SMDQTLRLWKWNVGENKVKALKVCRGHKRSVDSVSVDSSGTRFCSGSWDTMLKIWSVETDEE-DELESSSNRRR 238 (423)
T ss_pred eEEEe-cCCceEEEEEecCchhhhhHHhHhcccccceeEEEecCCCCeEEeecccceeeecccCCCcc-ccccccchhhh
Confidence 45666 7777888887753322211 12568889999999999999999999999432110 0110
Q ss_pred ------ccCCCC---CCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecC
Q 000080 2259 ------VLPAAN---VPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITS 2329 (2389)
Q Consensus 2259 ------vl~gh~---~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~ 2329 (2389)
...+.+ +...||...|.+|.|++ ...+-|+|.|.|||.||+++|+ ...++.+ .+..++|+++|
T Consensus 239 k~~~~~~~~~~r~P~vtl~GHt~~Vs~V~w~d-~~v~yS~SwDHTIk~WDletg~-----~~~~~~~-~ksl~~i~~~~- 310 (423)
T KOG0313|consen 239 KKQKREKEGGTRTPLVTLEGHTEPVSSVVWSD-ATVIYSVSWDHTIKVWDLETGG-----LKSTLTT-NKSLNCISYSP- 310 (423)
T ss_pred hhhhhhhcccccCceEEecccccceeeEEEcC-CCceEeecccceEEEEEeeccc-----ceeeeec-CcceeEeeccc-
Confidence 000011 12458899999999999 6689999999999999999985 2333332 46788999999
Q ss_pred CCCEEEEeecCCCCCeEEEeeCCCCCCCc-eEEEEeecCcEEEEeecccchhhh
Q 000080 2330 SGSVIAAAGHSSNGINVVVWDTLAPPTSS-RASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus 2330 DGslLASAG~sS~D~TVrLWD~l~~tg~~-v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
...+||+| |.|+.|||||.....+.. .++|.||.++|.++.-+|.--|.|
T Consensus 311 ~~~Ll~~g---ssdr~irl~DPR~~~gs~v~~s~~gH~nwVssvkwsp~~~~~~ 361 (423)
T KOG0313|consen 311 LSKLLASG---SSDRHIRLWDPRTGDGSVVSQSLIGHKNWVSSVKWSPTNEFQL 361 (423)
T ss_pred ccceeeec---CCCCceeecCCCCCCCceeEEeeecchhhhhheecCCCCceEE
Confidence 88999986 689999999997665555 489999999999999888766544
No 79
>KOG0264 consensus Nucleosome remodeling factor, subunit CAF1/NURF55/MSI1 [Chromatin structure and dynamics]
Probab=99.40 E-value=1.4e-12 Score=157.48 Aligned_cols=145 Identities=16% Similarity=0.266 Sum_probs=118.2
Q ss_pred eEEEEEEcCC-CCeEEEEeCCCcEEEeecCCCc--eeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEE
Q 000080 2221 STRAFSSHPL-RPFFLVGSSNTHIYLWEFGKDK--ATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVC 2296 (2389)
Q Consensus 2221 ~VrsVAFsPd-G~~LASGS~DgTIRLWDl~tGk--~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVk 2296 (2389)
.|..|+|||- ..+++|.++|+.+.|||+++++ +..+- .+|.+.|.+|+|+|-+ ..|||||.|+||+
T Consensus 229 ~VeDV~~h~~h~~lF~sv~dd~~L~iwD~R~~~~~~~~~~----------~ah~~~vn~~~fnp~~~~ilAT~S~D~tV~ 298 (422)
T KOG0264|consen 229 VVEDVAWHPLHEDLFGSVGDDGKLMIWDTRSNTSKPSHSV----------KAHSAEVNCVAFNPFNEFILATGSADKTVA 298 (422)
T ss_pred ceehhhccccchhhheeecCCCeEEEEEcCCCCCCCcccc----------cccCCceeEEEeCCCCCceEEeccCCCcEE
Confidence 4577899996 4489999999999999999642 22221 3578999999999975 7999999999999
Q ss_pred EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCC------------CceEEEEe
Q 000080 2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPT------------SSRASITC 2364 (2389)
Q Consensus 2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg------------~~v~sL~G 2364 (2389)
|||++.-. +++.++.+|...|..|.|||+..++|||+| .|+.+.+||+..-.. +.+-.--|
T Consensus 299 LwDlRnL~----~~lh~~e~H~dev~~V~WSPh~etvLASSg---~D~rl~vWDls~ig~eq~~eda~dgppEllF~HgG 371 (422)
T KOG0264|consen 299 LWDLRNLN----KPLHTFEGHEDEVFQVEWSPHNETVLASSG---TDRRLNVWDLSRIGEEQSPEDAEDGPPELLFIHGG 371 (422)
T ss_pred Eeechhcc----cCceeccCCCcceEEEEeCCCCCceeEecc---cCCcEEEEeccccccccChhhhccCCcceeEEecC
Confidence 99999752 688999999999999999999889999974 899999999832111 12345578
Q ss_pred ecCcEEEEeecccchhhh
Q 000080 2365 HEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus 2365 H~~~V~svA~~~~~~~~~ 2382 (2389)
|+..|..++-.|.-.|.+
T Consensus 372 H~~kV~DfsWnp~ePW~I 389 (422)
T KOG0264|consen 372 HTAKVSDFSWNPNEPWTI 389 (422)
T ss_pred cccccccccCCCCCCeEE
Confidence 999999999888877754
No 80
>KOG0281 consensus Beta-TrCP (transducin repeats containing)/Slimb proteins [Function unknown]
Probab=99.39 E-value=3.3e-13 Score=157.76 Aligned_cols=131 Identities=15% Similarity=0.188 Sum_probs=109.3
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.|..|.|+ .++|+|+|.|.|||+|++.++.+++|+. ||...|.++++ .|++++|||.|+||||||+
T Consensus 322 aVNvVdfd--~kyIVsASgDRTikvW~~st~efvRtl~----------gHkRGIAClQY--r~rlvVSGSSDntIRlwdi 387 (499)
T KOG0281|consen 322 AVNVVDFD--DKYIVSASGDRTIKVWSTSTCEFVRTLN----------GHKRGIACLQY--RDRLVVSGSSDNTIRLWDI 387 (499)
T ss_pred heeeeccc--cceEEEecCCceEEEEeccceeeehhhh----------cccccceehhc--cCeEEEecCCCceEEEEec
Confidence 44566775 4599999999999999999999999983 56677777766 6899999999999999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCC-------CceEEEEeecCcEEEEe
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPT-------SSRASITCHEGLYDLFL 2373 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg-------~~v~sL~GH~~~V~svA 2373 (2389)
+.| .+++-++||+.-|++|.|.. +.|+||| -||+||+||+..+-. -|+.++.-|++.|--+-
T Consensus 388 ~~G-----~cLRvLeGHEeLvRciRFd~---krIVSGa---YDGkikvWdl~aaldpra~~~~~Cl~~lv~hsgRVFrLQ 456 (499)
T KOG0281|consen 388 ECG-----ACLRVLEGHEELVRCIRFDN---KRIVSGA---YDGKIKVWDLQAALDPRAPASTLCLRTLVEHSGRVFRLQ 456 (499)
T ss_pred ccc-----HHHHHHhchHHhhhheeecC---ceeeecc---ccceEEEEecccccCCcccccchHHHhhhhccceeEEEe
Confidence 997 57888999999999999986 8899964 899999999843222 26788888999998776
Q ss_pred ecc
Q 000080 2374 PLK 2376 (2389)
Q Consensus 2374 ~~~ 2376 (2389)
|.+
T Consensus 457 FD~ 459 (499)
T KOG0281|consen 457 FDE 459 (499)
T ss_pred ecc
Confidence 643
No 81
>KOG1407 consensus WD40 repeat protein [Function unknown]
Probab=99.39 E-value=1.3e-12 Score=149.67 Aligned_cols=150 Identities=17% Similarity=0.205 Sum_probs=129.3
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEee
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWD 2299 (2389)
.|++|+|+-+|..||+||.|+++++|++..++.+..+. . -||.+.|-+++++|.. ..||+++.|.+|++||
T Consensus 22 ~v~Sv~wn~~g~~lasgs~dktv~v~n~e~~r~~~~~~---~-----~gh~~svdql~w~~~~~d~~atas~dk~ir~wd 93 (313)
T KOG1407|consen 22 KVHSVAWNCDGTKLASGSFDKTVSVWNLERDRFRKELV---Y-----RGHTDSVDQLCWDPKHPDLFATASGDKTIRIWD 93 (313)
T ss_pred cceEEEEcccCceeeecccCCceEEEEecchhhhhhhc---c-----cCCCcchhhheeCCCCCcceEEecCCceEEEEE
Confidence 45889999999999999999999999998886655442 1 2677999999999764 8999999999999999
Q ss_pred CCCCCc--------------------------------------------------------------------------
Q 000080 2300 LEVGGR-------------------------------------------------------------------------- 2305 (2389)
Q Consensus 2300 l~tggr-------------------------------------------------------------------------- 2305 (2389)
++++..
T Consensus 94 ~r~~k~~~~i~~~~eni~i~wsp~g~~~~~~~kdD~it~id~r~~~~~~~~~~~~e~ne~~w~~~nd~Fflt~GlG~v~I 173 (313)
T KOG1407|consen 94 IRSGKCTARIETKGENINITWSPDGEYIAVGNKDDRITFIDARTYKIVNEEQFKFEVNEISWNNSNDLFFLTNGLGCVEI 173 (313)
T ss_pred eccCcEEEEeeccCcceEEEEcCCCCEEEEecCcccEEEEEecccceeehhcccceeeeeeecCCCCEEEEecCCceEEE
Confidence 988632
Q ss_pred ---cCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhh
Q 000080 2306 ---SNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus 2306 ---s~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
-.++|++++.+|+..+.+|.|+| +|+++|+| |.|..|-|||+ ..--|++++.-|+-+|+.|+|+-+|+.+-
T Consensus 174 LsypsLkpv~si~AH~snCicI~f~p-~GryfA~G---sADAlvSLWD~--~ELiC~R~isRldwpVRTlSFS~dg~~lA 247 (313)
T KOG1407|consen 174 LSYPSLKPVQSIKAHPSNCICIEFDP-DGRYFATG---SADALVSLWDV--DELICERCISRLDWPVRTLSFSHDGRMLA 247 (313)
T ss_pred EeccccccccccccCCcceEEEEECC-CCceEeec---cccceeeccCh--hHhhhheeeccccCceEEEEeccCcceee
Confidence 13578899999999999999999 99999996 69999999998 33457899999999999999999999876
Q ss_pred cc
Q 000080 2383 SK 2384 (2389)
Q Consensus 2383 s~ 2384 (2389)
|.
T Consensus 248 Sa 249 (313)
T KOG1407|consen 248 SA 249 (313)
T ss_pred cc
Confidence 64
No 82
>KOG0303 consensus Actin-binding protein Coronin, contains WD40 repeats [Cytoskeleton]
Probab=99.39 E-value=8.6e-13 Score=156.77 Aligned_cols=134 Identities=19% Similarity=0.255 Sum_probs=108.9
Q ss_pred eEEEEEEcC-CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEe
Q 000080 2221 STRAFSSHP-LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTW 2298 (2389)
Q Consensus 2221 ~VrsVAFsP-dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLW 2298 (2389)
+|-.++|+| +.+.|||||+|.+|++|++-.+...+.+.. |. .-..||...|--|++.|-. +.|+|++.|++|.+|
T Consensus 83 ~vLDi~w~PfnD~vIASgSeD~~v~vW~IPe~~l~~~lte-pv--v~L~gH~rrVg~V~wHPtA~NVLlsag~Dn~v~iW 159 (472)
T KOG0303|consen 83 PVLDIDWCPFNDCVIASGSEDTKVMVWQIPENGLTRDLTE-PV--VELYGHQRRVGLVQWHPTAPNVLLSAGSDNTVSIW 159 (472)
T ss_pred cccccccCccCCceeecCCCCceEEEEECCCcccccCccc-ce--EEEeecceeEEEEeecccchhhHhhccCCceEEEE
Confidence 457779999 566899999999999999987665544320 00 1134788999999999996 899999999999999
Q ss_pred eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcE
Q 000080 2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLY 2369 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V 2369 (2389)
|+.||. .+.++. |..-|+++.|+. ||++|+|+ +.|+.|||||. .+++.++.-.+|++.-
T Consensus 160 nv~tge-----ali~l~-hpd~i~S~sfn~-dGs~l~Tt---ckDKkvRv~dp--r~~~~v~e~~~heG~k 218 (472)
T KOG0303|consen 160 NVGTGE-----ALITLD-HPDMVYSMSFNR-DGSLLCTT---CKDKKVRVIDP--RRGTVVSEGVAHEGAK 218 (472)
T ss_pred eccCCc-----eeeecC-CCCeEEEEEecc-CCceeeee---cccceeEEEcC--CCCcEeeecccccCCC
Confidence 999983 455665 999999999999 99999996 69999999997 4566677778888643
No 83
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.37 E-value=1.7e-12 Score=147.68 Aligned_cols=178 Identities=20% Similarity=0.294 Sum_probs=121.8
Q ss_pred eee-eccCCCCCeeEEEEcCCCCCCCcEE-EecCCeEEEEeeCCCCCCCCccceeeEEec-ccceEEEEeecC--CCCeE
Q 000080 86 QVF-ALSDNSLPVTSISWSPETPSIGQLA-AASENCIFVFAHDSASSKGSFCWSQNAILV-QGTKVEAIEWTG--SGDGI 160 (2389)
Q Consensus 86 Qvi-egh~d~~dVk~VaWSPd~~~~GeIa-ASyDntIRVw~~d~~~~kgd~~W~~~~tL~-hssTV~sIAWSp--dG~rL 160 (2389)
|.| .+|.| -|-.+.--=. +..|| ||+|++||||.-.+ +-+=...++|+ |++.||.++|-- -|..|
T Consensus 4 q~idt~H~D--~IHda~lDyy---gkrlATcsSD~tVkIf~v~~-----n~~s~ll~~L~Gh~GPVwqv~wahPk~G~iL 73 (299)
T KOG1332|consen 4 QTIDTQHED--MIHDAQLDYY---GKRLATCSSDGTVKIFEVRN-----NGQSKLLAELTGHSGPVWKVAWAHPKFGTIL 73 (299)
T ss_pred eehhhhhhh--hhhHhhhhhh---cceeeeecCCccEEEEEEcC-----CCCceeeeEecCCCCCeeEEeecccccCcEe
Confidence 444 44555 3333333332 45677 57899999998652 11224466776 899999999998 99999
Q ss_pred EEEecc--eEEeeccCCcEEEEEEeeccccceEEEEeecCC--Cc-eEeeecccccccCCCCCCCceeEEEeeCCCccce
Q 000080 161 VAGGME--TVLWKKKNTLWEIAWKFKENYPQNLVSATWSIE--GP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYI 235 (2389)
Q Consensus 161 aSggdD--V~IW~~~~s~Wecvwt~~~~~~~~ivsvaWSpd--G~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~ 235 (2389)
|||+.| |-||+..++.|...... ..|..++-+|+|-|. |. +|.++.|.+ -+|+.+..++.-.-.
T Consensus 74 AScsYDgkVIiWke~~g~w~k~~e~-~~h~~SVNsV~wapheygl~LacasSDG~----------vsvl~~~~~g~w~t~ 142 (299)
T KOG1332|consen 74 ASCSYDGKVIIWKEENGRWTKAYEH-AAHSASVNSVAWAPHEYGLLLACASSDGK----------VSVLTYDSSGGWTTS 142 (299)
T ss_pred eEeecCceEEEEecCCCchhhhhhh-hhhcccceeecccccccceEEEEeeCCCc----------EEEEEEcCCCCccch
Confidence 999998 88999999999876542 345556668899996 55 888888765 234433333333334
Q ss_pred eecccCCCCeeEEEeccCCCC---CCCCCCccccCceEEeeecCCeEEEEEeec
Q 000080 236 KLELCHPQPVSMVQWRPSTRR---HSPGDTKRSQRHVLLTCCLDGTVRLWCEMD 286 (2389)
Q Consensus 236 ~ve~aH~qdVn~V~W~Ps~~~---~~~~Dgk~~~~nILAScSdDgTVRLW~e~d 286 (2389)
....||+.-||+|+|.|.+.- ...+-.. .-..|||++-|++||||+++.
T Consensus 143 ki~~aH~~GvnsVswapa~~~g~~~~~~~~~--~~krlvSgGcDn~VkiW~~~~ 194 (299)
T KOG1332|consen 143 KIVFAHEIGVNSVSWAPASAPGSLVDQGPAA--KVKRLVSGGCDNLVKIWKFDS 194 (299)
T ss_pred hhhhccccccceeeecCcCCCccccccCccc--ccceeeccCCccceeeeecCC
Confidence 467999999999999995321 1111111 123499999999999999875
No 84
>KOG0640 consensus mRNA cleavage stimulating factor complex; subunit 1 [RNA processing and modification]
Probab=99.37 E-value=2.8e-12 Score=148.82 Aligned_cols=154 Identities=18% Similarity=0.323 Sum_probs=124.4
Q ss_pred cccceeeccccccccccccccCCCCc------CceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC
Q 000080 2192 AGIGASALGWETQDDFEDYVDPPATV------ENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV 2265 (2389)
Q Consensus 2192 ~~~~Asg~~~d~~~~~~~~~d~~atv------~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~ 2265 (2389)
..|+||| +.|.+.++-+|.++.+.. +--.||+|+|||.|.+|+.|.+--++||+|+.+-+|...-.
T Consensus 184 e~ILiS~-srD~tvKlFDfsK~saKrA~K~~qd~~~vrsiSfHPsGefllvgTdHp~~rlYdv~T~Qcfvsan------- 255 (430)
T KOG0640|consen 184 ETILISG-SRDNTVKLFDFSKTSAKRAFKVFQDTEPVRSISFHPSGEFLLVGTDHPTLRLYDVNTYQCFVSAN------- 255 (430)
T ss_pred hheEEec-cCCCeEEEEecccHHHHHHHHHhhccceeeeEeecCCCceEEEecCCCceeEEeccceeEeeecC-------
Confidence 3478899 889999999997554331 11256999999999999999999999999999988865432
Q ss_pred CCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceee-eecC-CCeeEEEEecCCCCEEEEeecCCCC
Q 000080 2266 PPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESC-LCFS-SHAMDVSYITSSGSVIAAAGHSSNG 2343 (2389)
Q Consensus 2266 p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl-~gHs-~~V~sVAFSP~DGslLASAG~sS~D 2343 (2389)
|.-+|++.|++|.+|+.|+..++||-||.|||||=-++ +++.++ ..|. ..|.+..|.. +|++|.|+| .|
T Consensus 256 Pd~qht~ai~~V~Ys~t~~lYvTaSkDG~IklwDGVS~-----rCv~t~~~AH~gsevcSa~Ftk-n~kyiLsSG---~D 326 (430)
T KOG0640|consen 256 PDDQHTGAITQVRYSSTGSLYVTASKDGAIKLWDGVSN-----RCVRTIGNAHGGSEVCSAVFTK-NGKYILSSG---KD 326 (430)
T ss_pred cccccccceeEEEecCCccEEEEeccCCcEEeeccccH-----HHHHHHHhhcCCceeeeEEEcc-CCeEEeecC---Cc
Confidence 55679999999999999999999999999999997654 345443 2355 4567888998 999999975 89
Q ss_pred CeEEEeeCCCCCCCceEEEEe
Q 000080 2344 INVVVWDTLAPPTSSRASITC 2364 (2389)
Q Consensus 2344 ~TVrLWD~l~~tg~~v~sL~G 2364 (2389)
.+|+||.+ .++.+++...|
T Consensus 327 S~vkLWEi--~t~R~l~~YtG 345 (430)
T KOG0640|consen 327 STVKLWEI--STGRMLKEYTG 345 (430)
T ss_pred ceeeeeee--cCCceEEEEec
Confidence 99999998 67788776655
No 85
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.37 E-value=2.5e-12 Score=145.59 Aligned_cols=163 Identities=14% Similarity=0.120 Sum_probs=134.3
Q ss_pred cccccccccccc--cCCCC--cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEE
Q 000080 2200 GWETQDDFEDYV--DPPAT--VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASIS 2275 (2389)
Q Consensus 2200 ~~d~~~~~~~~~--d~~at--v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~ 2275 (2389)
|-|.+.|+|.-. ..+.| -++-.|..++.+.|..-++||+.|..|.+||+.+|+.++.|+ ||.+.|.
T Consensus 36 GsdrtvrLWNp~rg~liktYsghG~EVlD~~~s~Dnskf~s~GgDk~v~vwDV~TGkv~Rr~r----------gH~aqVN 105 (307)
T KOG0316|consen 36 GSDRTVRLWNPLRGALIKTYSGHGHEVLDAALSSDNSKFASCGGDKAVQVWDVNTGKVDRRFR----------GHLAQVN 105 (307)
T ss_pred CCCceEEeecccccceeeeecCCCceeeeccccccccccccCCCCceEEEEEcccCeeeeecc----------cccceee
Confidence 678899999642 11111 122477999999999999999999999999999999999986 5789999
Q ss_pred EEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCC
Q 000080 2276 ALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPP 2355 (2389)
Q Consensus 2276 sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~t 2355 (2389)
+|+|+.+...++|||-|.++|+||.++. ..+|++.+......|.+|...- ..|++| |-|||+|.+|+. .
T Consensus 106 tV~fNeesSVv~SgsfD~s~r~wDCRS~---s~ePiQildea~D~V~Si~v~~---heIvaG---S~DGtvRtydiR--~ 174 (307)
T KOG0316|consen 106 TVRFNEESSVVASGSFDSSVRLWDCRSR---SFEPIQILDEAKDGVSSIDVAE---HEIVAG---SVDGTVRTYDIR--K 174 (307)
T ss_pred EEEecCcceEEEeccccceeEEEEcccC---CCCccchhhhhcCceeEEEecc---cEEEee---ccCCcEEEEEee--c
Confidence 9999999999999999999999999974 3478888888889999998875 667654 799999999984 3
Q ss_pred CCceEEEEeecCcEEEEeecccchhhhccc
Q 000080 2356 TSSRASITCHEGLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus 2356 g~~v~sL~GH~~~V~svA~~~~~~~~~s~~ 2385 (2389)
|+..--..||+ |+|+.++++||+.|-.|
T Consensus 175 G~l~sDy~g~p--it~vs~s~d~nc~La~~ 202 (307)
T KOG0316|consen 175 GTLSSDYFGHP--ITSVSFSKDGNCSLASS 202 (307)
T ss_pred ceeehhhcCCc--ceeEEecCCCCEEEEee
Confidence 44444456666 99999999999987544
No 86
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=99.36 E-value=7.4e-12 Score=150.22 Aligned_cols=163 Identities=14% Similarity=0.160 Sum_probs=125.8
Q ss_pred ccccccccccccc--CCCCcC--ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEE
Q 000080 2200 GWETQDDFEDYVD--PPATVE--NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASIS 2275 (2389)
Q Consensus 2200 ~~d~~~~~~~~~d--~~atv~--ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~ 2275 (2389)
+-|..+++|..-. .++.+. .-+|+.+..||+|.||+++|.|+++-+-|+++|+++.... +. +..-.++
T Consensus 280 Sad~~i~vws~~~~s~~~~~~~h~~~V~~ls~h~tgeYllsAs~d~~w~Fsd~~~g~~lt~vs---~~-----~s~v~~t 351 (506)
T KOG0289|consen 280 SADEIIRVWSVPLSSEPTSSRPHEEPVTGLSLHPTGEYLLSASNDGTWAFSDISSGSQLTVVS---DE-----TSDVEYT 351 (506)
T ss_pred CCcceEEeeccccccCccccccccccceeeeeccCCcEEEEecCCceEEEEEccCCcEEEEEe---ec-----cccceeE
Confidence 4455566665421 111111 2367999999999999999999999999999999876542 10 1123589
Q ss_pred EEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCC
Q 000080 2276 ALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPP 2355 (2389)
Q Consensus 2276 sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~t 2355 (2389)
+.+|.|||..|++|..||.||+||+..+ .....+.||++.|.+|+|+- +|-+||++ ++|+.|++||+. .
T Consensus 352 s~~fHpDgLifgtgt~d~~vkiwdlks~-----~~~a~Fpght~~vk~i~FsE-NGY~Lat~---add~~V~lwDLR--K 420 (506)
T KOG0289|consen 352 SAAFHPDGLIFGTGTPDGVVKIWDLKSQ-----TNVAKFPGHTGPVKAISFSE-NGYWLATA---ADDGSVKLWDLR--K 420 (506)
T ss_pred EeeEcCCceEEeccCCCceEEEEEcCCc-----cccccCCCCCCceeEEEecc-CceEEEEE---ecCCeEEEEEeh--h
Confidence 9999999999999999999999999975 24667889999999999998 99999997 589999999984 2
Q ss_pred CCceEEEEeec-CcEEEEeecccchhh
Q 000080 2356 TSSRASITCHE-GLYDLFLPLKLLNFA 2381 (2389)
Q Consensus 2356 g~~v~sL~GH~-~~V~svA~~~~~~~~ 2381 (2389)
-+..++++--+ .+|.++.+...|.+.
T Consensus 421 l~n~kt~~l~~~~~v~s~~fD~SGt~L 447 (506)
T KOG0289|consen 421 LKNFKTIQLDEKKEVNSLSFDQSGTYL 447 (506)
T ss_pred hcccceeeccccccceeEEEcCCCCeE
Confidence 33466665443 268888888888764
No 87
>KOG0264 consensus Nucleosome remodeling factor, subunit CAF1/NURF55/MSI1 [Chromatin structure and dynamics]
Probab=99.36 E-value=2.9e-12 Score=154.74 Aligned_cols=148 Identities=16% Similarity=0.187 Sum_probs=117.8
Q ss_pred EEEEcCCCC-eEEEEeCCCcEEEeecCCCcee-eEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeC
Q 000080 2224 AFSSHPLRP-FFLVGSSNTHIYLWEFGKDKAT-ATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2224 sVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l-~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl 2300 (2389)
+++|++..+ .|+|||+|++|.+||+...... .+... .. -..||.+.|..|+|+|-- +.|+|+++|+.+.|||+
T Consensus 182 glsWn~~~~g~Lls~~~d~~i~lwdi~~~~~~~~~~~p-~~---~~~~h~~~VeDV~~h~~h~~lF~sv~dd~~L~iwD~ 257 (422)
T KOG0264|consen 182 GLSWNRQQEGTLLSGSDDHTICLWDINAESKEDKVVDP-KT---IFSGHEDVVEDVAWHPLHEDLFGSVGDDGKLMIWDT 257 (422)
T ss_pred ccccccccceeEeeccCCCcEEEEeccccccCCccccc-eE---EeecCCcceehhhccccchhhheeecCCCeEEEEEc
Confidence 358888776 6999999999999999754331 11100 00 124788999999999875 89999999999999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
+++ . .++..+..+|++.|++++|+|-++.+|||| |.|+||+|||+.. =.++++++++|...|.+|-.+|.-.-
T Consensus 258 R~~-~--~~~~~~~~ah~~~vn~~~fnp~~~~ilAT~---S~D~tV~LwDlRn-L~~~lh~~e~H~dev~~V~WSPh~et 330 (422)
T KOG0264|consen 258 RSN-T--SKPSHSVKAHSAEVNCVAFNPFNEFILATG---SADKTVALWDLRN-LNKPLHTFEGHEDEVFQVEWSPHNET 330 (422)
T ss_pred CCC-C--CCCcccccccCCceeEEEeCCCCCceEEec---cCCCcEEEeechh-cccCceeccCCCcceEEEEeCCCCCc
Confidence 974 1 267778889999999999999999999996 6899999999852 23579999999999999988876554
Q ss_pred hh
Q 000080 2381 AL 2382 (2389)
Q Consensus 2381 ~~ 2382 (2389)
+|
T Consensus 331 vL 332 (422)
T KOG0264|consen 331 VL 332 (422)
T ss_pred ee
Confidence 43
No 88
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=99.35 E-value=1.6e-12 Score=147.93 Aligned_cols=164 Identities=20% Similarity=0.205 Sum_probs=127.1
Q ss_pred cceeeccccccccccccc--cCCCCcCc-eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceee-EecccCCCCCCCCC
Q 000080 2194 IGASALGWETQDDFEDYV--DPPATVEN-ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATA-TYGVLPAANVPPPY 2269 (2389)
Q Consensus 2194 ~~Asg~~~d~~~~~~~~~--d~~atv~n-i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~-Tl~vl~gh~~p~~G 2269 (2389)
.+|++ ..|-+.++|+.+ |..-+.+. --|++++|+.|.++|++|+.+.-+|++|+.+.++.. .+ .|
T Consensus 73 ~aasa-aadftakvw~a~tgdelhsf~hkhivk~~af~~ds~~lltgg~ekllrvfdln~p~App~E~----------~g 141 (334)
T KOG0278|consen 73 RAASA-AADFTAKVWDAVTGDELHSFEHKHIVKAVAFSQDSNYLLTGGQEKLLRVFDLNRPKAPPKEI----------SG 141 (334)
T ss_pred hhhhh-cccchhhhhhhhhhhhhhhhhhhheeeeEEecccchhhhccchHHHhhhhhccCCCCCchhh----------cC
Confidence 34555 556666666654 33333322 127999999999999999999999999998777533 23 36
Q ss_pred CCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEe
Q 000080 2270 ALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVW 2349 (2389)
Q Consensus 2270 H~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLW 2349 (2389)
|.+.|+.+-|-.-.+.|.|.+.|+||||||.++|. .+.+++ ...+|.++-+++ ||++|.++ ..++|+.|
T Consensus 142 htg~Ir~v~wc~eD~~iLSSadd~tVRLWD~rTgt-----~v~sL~-~~s~VtSlEvs~-dG~ilTia----~gssV~Fw 210 (334)
T KOG0278|consen 142 HTGGIRTVLWCHEDKCILSSADDKTVRLWDHRTGT-----EVQSLE-FNSPVTSLEVSQ-DGRILTIA----YGSSVKFW 210 (334)
T ss_pred CCCcceeEEEeccCceEEeeccCCceEEEEeccCc-----EEEEEe-cCCCCcceeecc-CCCEEEEe----cCceeEEe
Confidence 78999999999999999999999999999999983 455553 677899999999 99988775 67889999
Q ss_pred eCC---------------------------------------CCCCCceEEE-EeecCcEEEEeecccch
Q 000080 2350 DTL---------------------------------------APPTSSRASI-TCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus 2350 D~l---------------------------------------~~tg~~v~sL-~GH~~~V~svA~~~~~~ 2379 (2389)
|.. ..++..+.++ .||.++|.||.++|+|.
T Consensus 211 daksf~~lKs~k~P~nV~SASL~P~k~~fVaGged~~~~kfDy~TgeEi~~~nkgh~gpVhcVrFSPdGE 280 (334)
T KOG0278|consen 211 DAKSFGLLKSYKMPCNVESASLHPKKEFFVAGGEDFKVYKFDYNTGEEIGSYNKGHFGPVHCVRFSPDGE 280 (334)
T ss_pred ccccccceeeccCccccccccccCCCceEEecCcceEEEEEeccCCceeeecccCCCCceEEEEECCCCc
Confidence 950 1244455555 88999999999999996
No 89
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=99.35 E-value=4.8e-12 Score=151.77 Aligned_cols=142 Identities=19% Similarity=0.303 Sum_probs=112.5
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
|.+.+.+|||||-++++|+.|+.||+||+..+..+..| |||++.|.+|+|+-+|-+||++++|+.|+|||
T Consensus 348 v~~ts~~fHpDgLifgtgt~d~~vkiwdlks~~~~a~F----------pght~~vk~i~FsENGY~Lat~add~~V~lwD 417 (506)
T KOG0289|consen 348 VEYTSAAFHPDGLIFGTGTPDGVVKIWDLKSQTNVAKF----------PGHTGPVKAISFSENGYWLATAADDGSVKLWD 417 (506)
T ss_pred ceeEEeeEcCCceEEeccCCCceEEEEEcCCccccccC----------CCCCCceeEEEeccCceEEEEEecCCeEEEEE
Confidence 56789999999999999999999999999888866655 46889999999999999999999999999999
Q ss_pred CCCCCccCcccceeeeecC-CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080 2300 LEVGGRSNVRPMESCLCFS-SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs-~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
++.- +.+.+++--. ..|.++.|.+ +|++|+.+| .|=+|.+.+-...+-+++..+.-|.+..++|.+-+.-
T Consensus 418 LRKl-----~n~kt~~l~~~~~v~s~~fD~-SGt~L~~~g---~~l~Vy~~~k~~k~W~~~~~~~~~sg~st~v~Fg~~a 488 (506)
T KOG0289|consen 418 LRKL-----KNFKTIQLDEKKEVNSLSFDQ-SGTYLGIAG---SDLQVYICKKKTKSWTEIKELADHSGLSTGVRFGEHA 488 (506)
T ss_pred ehhh-----cccceeeccccccceeEEEcC-CCCeEEeec---ceeEEEEEecccccceeeehhhhcccccceeeecccc
Confidence 9864 3344443222 3699999999 999999874 5555555553223445678888899888888876654
Q ss_pred hh
Q 000080 2379 NF 2380 (2389)
Q Consensus 2379 ~~ 2380 (2389)
.+
T Consensus 489 q~ 490 (506)
T KOG0289|consen 489 QY 490 (506)
T ss_pred eE
Confidence 43
No 90
>KOG2445 consensus Nuclear pore complex component (sc Seh1) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=99.35 E-value=9.6e-11 Score=136.79 Aligned_cols=248 Identities=17% Similarity=0.311 Sum_probs=169.0
Q ss_pred CCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEE--ecCCeEEEEeeC
Q 000080 49 DFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAA--ASENCIFVFAHD 126 (2389)
Q Consensus 49 D~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaA--SyDntIRVw~~d 126 (2389)
|+-|-...++++.-.|=|..+.++..++++. ..-..|+ ..|+.|.|-| |.-|+++| |||.||+||+++
T Consensus 22 D~~GRRmAtCSsDq~vkI~d~~~~s~~W~~T------s~Wrah~--~Si~rV~WAh--PEfGqvvA~cS~Drtv~iWEE~ 91 (361)
T KOG2445|consen 22 DFYGRRMATCSSDQTVKIWDSTSDSGTWSCT------SSWRAHD--GSIWRVVWAH--PEFGQVVATCSYDRTVSIWEEQ 91 (361)
T ss_pred cccCceeeeccCCCcEEEEeccCCCCceEEe------eeEEecC--CcEEEEEecC--ccccceEEEEecCCceeeeeec
Confidence 5558434455555556666666788888877 5555554 3799999977 66899986 689999999985
Q ss_pred CCCC-CCCccceeeEEecc-cceEEEEeecCC--CCeEEEEecc--eEEeeccC----CcEEEEEEee------ccccce
Q 000080 127 SASS-KGSFCWSQNAILVQ-GTKVEAIEWTGS--GDGIVAGGME--TVLWKKKN----TLWEIAWKFK------ENYPQN 190 (2389)
Q Consensus 127 ~~~~-kgd~~W~~~~tL~h-ssTV~sIAWSpd--G~rLaSggdD--V~IW~~~~----s~Wecvwt~~------~~~~~~ 190 (2389)
.... ...-+|....+|.. .+.|.+|.|.|. |-.||+|+-| ++|++..+ +.|...-.++ +.+.++
T Consensus 92 ~~~~~~~~~~Wv~~ttl~DsrssV~DV~FaP~hlGLklA~~~aDG~lRIYEA~dp~nLs~W~Lq~Ei~~~~~pp~~~~~~ 171 (361)
T KOG2445|consen 92 EKSEEAHGRRWVRRTTLVDSRSSVTDVKFAPKHLGLKLAAASADGILRIYEAPDPMNLSQWTLQHEIQNVIDPPGKNKQP 171 (361)
T ss_pred ccccccccceeEEEEEeecCCcceeEEEecchhcceEEEEeccCcEEEEEecCCccccccchhhhhhhhccCCcccccCc
Confidence 2111 11247999999975 669999999997 6688899887 99999543 4565443332 235567
Q ss_pred EEEEeecCCC---c-eEeeecccccccCCCCCCCceeEEEeeCCCc-cceee--cccCCCCeeEEEeccCCCCCCCCCCc
Q 000080 191 LVSATWSIEG---P-SATAASMSQLDLLGPKEAGKCVFICCSDGKS-EYIKL--ELCHPQPVSMVQWRPSTRRHSPGDTK 263 (2389)
Q Consensus 191 ivsvaWSpdG---~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~-~~~~v--e~aH~qdVn~V~W~Ps~~~~~~~Dgk 263 (2389)
-.|++|+|.- + ||.++.. .++.-+.|.|++++... .+..+ ...|+.+|..++|.|.- +
T Consensus 172 ~~CvsWn~sr~~~p~iAvgs~e-------~a~~~~~~~Iye~~e~~rKw~kva~L~d~~dpI~di~wAPn~--------G 236 (361)
T KOG2445|consen 172 CFCVSWNPSRMHEPLIAVGSDE-------DAPHLNKVKIYEYNENGRKWLKVAELPDHTDPIRDISWAPNI--------G 236 (361)
T ss_pred ceEEeeccccccCceEEEEccc-------CCccccceEEEEecCCcceeeeehhcCCCCCcceeeeecccc--------C
Confidence 8899999853 3 7777664 13444668888876554 34443 36899999999999942 2
Q ss_pred cccCceEEeeecCCeEEEEEeecCC-------------ccc---ccccccCCCCcc--ceeEEEEEEEeecccccCCC
Q 000080 264 RSQRHVLLTCCLDGTVRLWCEMDSG-------------KTR---KVAKDTNDHKTI--RRSFCVGAIIEINQALNGAL 323 (2389)
Q Consensus 264 ~~~~nILAScSdDgTVRLW~e~d~G-------------k~k---k~~~~~~d~~~~--~~sF~vaA~I~~~~~~~~~l 323 (2389)
+ .-++||++|.|| ||||.....- ..+ ++-..-.||+.. ++.|-+-++|=...-..||+
T Consensus 237 r-~y~~lAvA~kDg-v~I~~v~~~~s~i~~ee~~~~~~~~~l~v~~vs~~~~H~~~VWrv~wNmtGtiLsStGdDG~V 312 (361)
T KOG2445|consen 237 R-SYHLLAVATKDG-VRIFKVKVARSAIEEEEVLAPDLMTDLPVEKVSELDDHNGEVWRVRWNMTGTILSSTGDDGCV 312 (361)
T ss_pred C-ceeeEEEeecCc-EEEEEEeeccchhhhhcccCCCCccccceEEeeeccCCCCceEEEEEeeeeeEEeecCCCcee
Confidence 2 478999999999 9999977311 000 000011257643 78888888877666455554
No 91
>KOG0293 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.32 E-value=7.3e-12 Score=149.39 Aligned_cols=144 Identities=10% Similarity=0.111 Sum_probs=118.8
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCce---eeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEE
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKA---TATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCT 2297 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~---l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkL 2297 (2389)
.|+-+.||++|++|||||.|.|.-+|++..... ..|+. ||...|.-|.||||.++|.+++.|..++|
T Consensus 226 EVWfl~FS~nGkyLAsaSkD~Taiiw~v~~d~~~kl~~tlv----------gh~~~V~yi~wSPDdryLlaCg~~e~~~l 295 (519)
T KOG0293|consen 226 EVWFLQFSHNGKYLASASKDSTAIIWIVVYDVHFKLKKTLV----------GHSQPVSYIMWSPDDRYLLACGFDEVLSL 295 (519)
T ss_pred cEEEEEEcCCCeeEeeccCCceEEEEEEecCcceeeeeeee----------cccCceEEEEECCCCCeEEecCchHheee
Confidence 459999999999999999999999999876654 45552 57799999999999999999999999999
Q ss_pred eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeec-CcEEEEeecc
Q 000080 2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHE-GLYDLFLPLK 2376 (2389)
Q Consensus 2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~-~~V~svA~~~ 2376 (2389)
||+.+|.. ...+. .+|...+.+++|.| ||..+++| |.|++|..||+ .|+.+.+-+|-. ..|.++|..+
T Consensus 296 wDv~tgd~---~~~y~-~~~~~S~~sc~W~p-Dg~~~V~G---s~dr~i~~wdl---Dgn~~~~W~gvr~~~v~dlait~ 364 (519)
T KOG0293|consen 296 WDVDTGDL---RHLYP-SGLGFSVSSCAWCP-DGFRFVTG---SPDRTIIMWDL---DGNILGNWEGVRDPKVHDLAITY 364 (519)
T ss_pred ccCCcchh---hhhcc-cCcCCCcceeEEcc-CCceeEec---CCCCcEEEecC---CcchhhcccccccceeEEEEEcC
Confidence 99999851 22222 33668899999999 99999985 68999999997 455555555543 5588999999
Q ss_pred cchhhhccc
Q 000080 2377 LLNFALSKC 2385 (2389)
Q Consensus 2377 ~~~~~~s~~ 2385 (2389)
||.+.|.-|
T Consensus 365 Dgk~vl~v~ 373 (519)
T KOG0293|consen 365 DGKYVLLVT 373 (519)
T ss_pred CCcEEEEEe
Confidence 999988765
No 92
>KOG1063 consensus RNA polymerase II elongator complex, subunit ELP2, WD repeat superfamily [Chromatin structure and dynamics; Transcription]
Probab=99.31 E-value=2e-09 Score=135.07 Aligned_cols=603 Identities=16% Similarity=0.217 Sum_probs=322.8
Q ss_pred ccccCCCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCC
Q 000080 31 EFIPTAPTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIG 110 (2389)
Q Consensus 31 ~~ip~ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~G 110 (2389)
+.+--.+.|.++..+|.|- | -+|||++..|++.. |... .....++||.. +|.|+.|=|+.....
T Consensus 7 ea~~Vgc~R~~~v~sw~~~--~--~vafGa~~~Iav~d---p~k~-------~i~t~l~GH~a--~VnC~~~l~~s~~~a 70 (764)
T KOG1063|consen 7 EAISVGCNRVPKVSSWGPG--G--LVAFGAGPAIAVAD---PEKI-------LIVTTLDGHVA--RVNCVHWLPTSEIVA 70 (764)
T ss_pred eeeeecccccccccccccc--c--eEEecCCceEEEeC---cccc-------eeEEeccCCcc--ceEEEEEcccccccc
Confidence 3445566799999999653 4 79999999999887 2222 12255688876 999999999711111
Q ss_pred cEEE-ecCCeEEEEeeCCCCCCCCccceeeEEecccceEEEEeecCCCCeEEE-Eecc-eEEeeccCCcEEEEEEeeccc
Q 000080 111 QLAA-ASENCIFVFAHDSASSKGSFCWSQNAILVQGTKVEAIEWTGSGDGIVA-GGME-TVLWKKKNTLWEIAWKFKENY 187 (2389)
Q Consensus 111 eIaA-SyDntIRVw~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSpdG~rLaS-ggdD-V~IW~~~~s~Wecvwt~~~~~ 187 (2389)
++++ +.|+.|++|+-. +..|.|..++.+ -.+..++.+.--..+.+ ++++ +.+|+.....--|.-.+.-+-
T Consensus 71 ~~vsG~sD~~v~lW~l~------~~~~~~i~~~~g-~~~~~~cv~a~~~~~~~~~ad~~v~vw~~~~~e~~~~~~~rf~~ 143 (764)
T KOG1063|consen 71 EMVSGDSDGRVILWKLR------DEYLIKIYTIQG-HCKECVCVVARSSVMTCKAADGTVSVWDKQQDEVFLLAVLRFEI 143 (764)
T ss_pred eEEEccCCCcEEEEEEe------ehheEEEEeecC-cceeEEEEEeeeeEEEeeccCceEEEeecCCCceeeehheehhh
Confidence 4665 468999999875 336999999987 55566666664444444 4555 889998555433322222111
Q ss_pred cceEE--EEeecC-CCceEeeec-ccccccCCCCCCCceeEEEeeCCCccceee--cccCCCCeeEEEeccCCCCCCCCC
Q 000080 188 PQNLV--SATWSI-EGPSATAAS-MSQLDLLGPKEAGKCVFICCSDGKSEYIKL--ELCHPQPVSMVQWRPSTRRHSPGD 261 (2389)
Q Consensus 188 ~~~iv--svaWSp-dG~fATag~-dikf~~~~~~~~~kpV~V~~~dg~~~~~~v--e~aH~qdVn~V~W~Ps~~~~~~~D 261 (2389)
.. ++ |.+-.| .|.++.+++ ..+ +...+.++...|..+ ..+|..-|.+++|+-.+ +
T Consensus 144 k~-~ipLcL~~~~~~~~~lla~Ggs~~------------~v~~~s~~~d~f~~v~el~GH~DWIrsl~f~~~~-----~- 204 (764)
T KOG1063|consen 144 KE-AIPLCLAALKNNKTFLLACGGSKF------------VVDLYSSSADSFARVAELEGHTDWIRSLAFARLG-----G- 204 (764)
T ss_pred hh-HhhHHHhhhccCCcEEEEecCcce------------EEEEeccCCcceeEEEEeeccchhhhhhhhhccC-----C-
Confidence 11 22 444455 566555544 322 111222222234443 47899999999998742 1
Q ss_pred CccccCceEEeeecCCeEEEEEeecCCccccccccc-----CCCCccceeEEEEEEEeecccccCCCCCCeEEEeecccc
Q 000080 262 TKRSQRHVLLTCCLDGTVRLWCEMDSGKTRKVAKDT-----NDHKTIRRSFCVGAIIEINQALNGALGMDIVITWAKEIR 336 (2389)
Q Consensus 262 gk~~~~nILAScSdDgTVRLW~e~d~Gk~kk~~~~~-----~d~~~~~~sF~vaA~I~~~~~~~~~l~~~~~v~W~~~~~ 336 (2389)
..-+|||||.|.+||||++...+..++.-... .+.+.--+-+++---|+..+.+-|-=.==..|+|=....
T Consensus 205 ----~~~~laS~SQD~yIRiW~i~~~~~~~~~~~e~~~t~~~~~~~f~~l~~i~~~is~eall~GHeDWV~sv~W~p~~~ 280 (764)
T KOG1063|consen 205 ----DDLLLASSSQDRYIRIWRIVLGDDEDSNEREDSLTTLSNLPVFMILEEIQYRISFEALLMGHEDWVYSVWWHPEGL 280 (764)
T ss_pred ----CcEEEEecCCceEEEEEEEEecCCccccccccccccccCCceeeeeeeEEEEEehhhhhcCcccceEEEEEccchh
Confidence 24579999999999999999877654311110 011111111122222222242223223335677777776
Q ss_pred ceeeccCCccceecccccccccceeeeee----EeecCCccceeEEEeeeccCCCCCcCeEEEeeeccccccCCCCCCCC
Q 000080 337 CMFETGEGANHFISTGVYEHGGTGKCEWL----VGYGPGSLVTLWAIHCLDDISPLRFPRVTLWKKQNLELEHPHNSGFS 412 (2389)
Q Consensus 337 ~vf~~~~e~~~~~~s~~~~~~~v~~~eW~----~~~~PGs~l~~W~v~~LDd~~~~R~prVt~~~r~~~~~~~~~~a~f~ 412 (2389)
.+-+.+++++-.+=-++- ++| =|. +|.--|+-+-||..+|--+
T Consensus 281 ~LLSASaDksmiiW~pd~---~tG--iWv~~vRlGe~gg~a~GF~g~lw~~n---------------------------- 327 (764)
T KOG1063|consen 281 DLLSASADKSMIIWKPDE---NTG--IWVDVVRLGEVGGSAGGFWGGLWSPN---------------------------- 327 (764)
T ss_pred hheecccCcceEEEecCC---ccc--eEEEEEEeecccccccceeeEEEcCC----------------------------
Confidence 666666555422211110 000 021 1111144444555554332
Q ss_pred CCcCccccceeEEeccccCCCCcccccccccccCcceeehhcccCCCCccccccCCCC-c-cceeeecccceeeeccccc
Q 000080 413 GFQGQSLLNKVVISRDCVSGLPTICSLVHLSHCNSLVWSLLHAQRSGDVEDVSSDKSS-T-GQILSCSASRILSIEGHTG 490 (2389)
Q Consensus 413 ~~~da~~l~~~vi~r~~~~g~p~~cs~~~l~~~N~~~~~~~h~~~sln~~~~s~~~~s-f-~~i~s~~~s~~~~~~GH~~ 490 (2389)
.++|+-+ ---|.+-+|- ++++ | ..-..+ -||..
T Consensus 328 ---------~~~ii~~-------------------------g~~Gg~hlWk---t~d~~~w~~~~~i--------SGH~~ 362 (764)
T KOG1063|consen 328 ---------SNVIIAH-------------------------GRTGGFHLWK---TKDKTFWTQEPVI--------SGHVD 362 (764)
T ss_pred ---------CCEEEEe-------------------------cccCcEEEEe---ccCccceeecccc--------ccccc
Confidence 0222211 1223334454 2332 1 222223 79999
Q ss_pred eEeEEeeeccccchhhhhccCCCccEEEEEecccccccCCCCCCCCccccccc------ccccccc-CCccceeeecccc
Q 000080 491 KILQVAVHPCVSEFELAVSLDSNGLLLFWSLSTISNCISDLPTLMPSWKLCGK------LRTRKSC-SNYTSLRWAPSLL 563 (2389)
Q Consensus 491 ~i~qv~~Hp~l~~l~Lt~S~d~~~~LilW~vspv~~~~~~~~~~~P~l~~~Gg------lar~~s~-~~ftsl~W~Psil 563 (2389)
-+.+|.-||.= |.+|++|+|--.-|. .| | |+ +||--.- -.-+||+-++.
T Consensus 363 ~V~dv~W~psG-eflLsvs~DQTTRlF-----------------a~-w---g~q~~wHEiaRPQiHGyDl~c~~~vn~-- 418 (764)
T KOG1063|consen 363 GVKDVDWDPSG-EFLLSVSLDQTTRLF-----------------AR-W---GRQQEWHEIARPQIHGYDLTCLSFVNE-- 418 (764)
T ss_pred cceeeeecCCC-CEEEEeccccceeee-----------------cc-c---ccccceeeecccccccccceeeehccC--
Confidence 99999999999 999999999764332 33 4 43 5554333 55566665554
Q ss_pred ccceEEEEeecCCeeEEEEeccccCCCCe--EeeeeEEEeccCCCCCCCCCceeeeecCCccCCcccccceEEEEEEeec
Q 000080 564 DEDMVLLMGHVGGIDCFIVKISQTEVDDI--VCHYVCTIPFTGHGHYEDGPANIFSVPLPSCNDKTVMYNKFMLLGVWLK 641 (2389)
Q Consensus 564 ~~~~~~fva~~gg~d~~l~~i~~~~~eni--t~~~~c~i~l~~~~~~~~~~~~ih~~p~~~~~~~tf~~n~f~lv~v~~~ 641 (2389)
..-|| +|+|.=+.+...--+ ++ ++...|-+.+-+.+.+.++- +.|.=-.=+|.|..
T Consensus 419 ---~~~FV---SgAdEKVlRvF~aPk-~fv~~l~~i~g~~~~~~~~~p~gA----~VpaLGLSnKa~~~----------- 476 (764)
T KOG1063|consen 419 ---DLQFV---SGADEKVLRVFEAPK-SFVKSLMAICGKCFKGSDELPDGA----NVPALGLSNKAFFP----------- 476 (764)
T ss_pred ---Cceee---ecccceeeeeecCcH-HHHHHHHHHhCccccCchhccccc----ccccccccCCCCcc-----------
Confidence 33343 344443444331111 11 22222322232222222220 00100011111110
Q ss_pred ccceeEEEEEEeeecCCcccccCCCCCCccccccCCcccccccceeeeeeccccCcCCCCCCcccccEEEEeecCCCcCC
Q 000080 642 GLESLSWEITFHSFDLSESCCGCIDDNNTVKCSMCKFETTFCGKKYFIGVNPCSSQFPEPHTRNWVTSFAVVCPNNLVPM 721 (2389)
Q Consensus 642 ~f~~l~W~v~l~s~~~~~~~~~c~~~~~~~~~~~~~~~~s~a~k~~~l~~~~cs~~~P~~~l~~~v~s~~~v~p~~~~~~ 721 (2389)
.+++ ... + +- +|-+.-| .... ++.-.| |+
T Consensus 477 ---------------~e~~---------------~G~---~-~~-------~~~et~~----~~~p--~~L~eP----P~ 505 (764)
T KOG1063|consen 477 ---------------GETN---------------TGG---E-AA-------VCAETPL----AAAP--CELTEP----PT 505 (764)
T ss_pred ---------------cccc---------------ccc---c-cc-------eeeeccc----ccCc--hhccCC----Ch
Confidence 0000 000 0 00 1211111 0000 000012 11
Q ss_pred CccccCCCCCCCCCCCeEEEEeecCCcEEEEEEEeCCCCCCceeeeeeeeeecCCCCceEEEeecCCCeEEEEccCCCCC
Q 000080 722 QQKLVYDNDPCSKIPPYTMATGYSDGSLRLWRSELGGSSTSCMPWELVGMLVAHQGPVSAISLTDGGRKIATVSAASHSN 801 (2389)
Q Consensus 722 ~~~l~s~~~~~~~~~pYliaT~CSDG~VRfWkc~v~~~~~~~y~We~w~ml~~~~G~p~~IS~a~tGR~a~a~~~~~~~~ 801 (2389)
..||- ..-.|.|..-+-.|+=.+.++.++++|-++|..|+.++ .
T Consensus 506 EdqLq-----------------------------------~~tLwPEv~KLYGHGyEv~~l~~s~~gnliASaCKS~~-~ 549 (764)
T KOG1063|consen 506 EDQLQ-----------------------------------QNTLWPEVHKLYGHGYEVYALAISPTGNLIASACKSSL-K 549 (764)
T ss_pred HHHHH-----------------------------------HhccchhhHHhccCceeEEEEEecCCCCEEeehhhhCC-c
Confidence 11111 24569999888889989999999999999988887433 3
Q ss_pred CccEEEEEeeccccCcceeEeeceeccCC-ceEEEEeEEccCCcEEEEEeecceEEEEEeccCCcccccccccccccccc
Q 000080 802 AVSNVRIWESVCVTELGSFVLEDTLSFDT-NIVAVNWLTLENGQSLLGVCLQNELKVYAQRHYGGQILLDTKNSLKMQNW 880 (2389)
Q Consensus 802 ~~s~vsIWD~~~~sgGGswvLE~ti~ld~-~IVdLDWtStEDGqhILTVGfg~kVlLYtQlRydytn~~~~~~ll~~~~w 880 (2389)
.-.-+-+|+. +.|.--+.+.++. .|-+|. ..+||..+|+|+=-+.+=||.+.+-+--. .+.
T Consensus 550 ehAvI~lw~t------~~W~~~~~L~~HsLTVT~l~--FSpdg~~LLsvsRDRt~sl~~~~~~~~~e----------~~f 611 (764)
T KOG1063|consen 550 EHAVIRLWNT------ANWLQVQELEGHSLTVTRLA--FSPDGRYLLSVSRDRTVSLYEVQEDIKDE----------FRF 611 (764)
T ss_pred cceEEEEEec------cchhhhheecccceEEEEEE--ECCCCcEEEEeecCceEEeeeeecccchh----------hhh
Confidence 3455999996 2588777777764 777994 57999999999999999999995543000 001
Q ss_pred eeeccCCCCCccccccccCce-EEEEecCe
Q 000080 881 FCLAFSPTFAAHDFTWGRRAI-AIVVHQSY 909 (2389)
Q Consensus 881 ~~Id~~~T~hIgDssWVRDGI-LVVGmgnE 909 (2389)
.++ ..||--|=|=+|.||+. ++-++-.+
T Consensus 612 a~~-k~HtRIIWdcsW~pde~~FaTaSRDK 640 (764)
T KOG1063|consen 612 ACL-KAHTRIIWDCSWSPDEKYFATASRDK 640 (764)
T ss_pred ccc-cccceEEEEcccCcccceeEEecCCc
Confidence 110 11222266678988887 66665543
No 93
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=99.31 E-value=1.9e-11 Score=144.85 Aligned_cols=143 Identities=17% Similarity=0.211 Sum_probs=120.6
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
-+|.+|+.||+.+++||||.|-...||++.+|.....+ +||.+.|+++.||.||.+||||+.+|.|++|+
T Consensus 65 ~svFavsl~P~~~l~aTGGgDD~AflW~~~~ge~~~el----------tgHKDSVt~~~FshdgtlLATGdmsG~v~v~~ 134 (399)
T KOG0296|consen 65 DSVFAVSLHPNNNLVATGGGDDLAFLWDISTGEFAGEL----------TGHKDSVTCCSFSHDGTLLATGDMSGKVLVFK 134 (399)
T ss_pred CceEEEEeCCCCceEEecCCCceEEEEEccCCcceeEe----------cCCCCceEEEEEccCceEEEecCCCccEEEEE
Confidence 35699999999999999999999999999999966655 46789999999999999999999999999999
Q ss_pred CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccch
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~ 2379 (2389)
+.+++ ....+.+--..+.=+.++| -+.+|+.| +.|+.|.+|.+ +.+...+.+.||..+++|=-+.|+|.
T Consensus 135 ~stg~-----~~~~~~~e~~dieWl~WHp-~a~illAG---~~DGsvWmw~i--p~~~~~kv~~Gh~~~ct~G~f~pdGK 203 (399)
T KOG0296|consen 135 VSTGG-----EQWKLDQEVEDIEWLKWHP-RAHILLAG---STDGSVWMWQI--PSQALCKVMSGHNSPCTCGEFIPDGK 203 (399)
T ss_pred cccCc-----eEEEeecccCceEEEEecc-cccEEEee---cCCCcEEEEEC--CCcceeeEecCCCCCcccccccCCCc
Confidence 99974 2333332234444478899 88888864 79999999998 45466899999999999999999999
Q ss_pred hhhc
Q 000080 2380 FALS 2383 (2389)
Q Consensus 2380 ~~~s 2383 (2389)
+++.
T Consensus 204 r~~t 207 (399)
T KOG0296|consen 204 RILT 207 (399)
T ss_pred eEEE
Confidence 8764
No 94
>KOG0306 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.30 E-value=1.2e-11 Score=155.13 Aligned_cols=137 Identities=18% Similarity=0.209 Sum_probs=119.0
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecC-----CCcee--------eEecccCCCCCCCCCCCCCEEEEEECCCCCEE
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFG-----KDKAT--------ATYGVLPAANVPPPYALASISALQFDHYGHRF 2286 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~-----tGk~l--------~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~L 2286 (2389)
..|++++.+||+..+++||.|.||++||+. .|... +++. + .+.|-+|++||||++|
T Consensus 455 gaIWsi~~~pD~~g~vT~saDktVkfWdf~l~~~~~gt~~k~lsl~~~rtLe-l----------~ddvL~v~~Spdgk~L 523 (888)
T KOG0306|consen 455 GAIWSISLSPDNKGFVTGSADKTVKFWDFKLVVSVPGTQKKVLSLKHTRTLE-L----------EDDVLCVSVSPDGKLL 523 (888)
T ss_pred cceeeeeecCCCCceEEecCCcEEEEEeEEEEeccCcccceeeeeccceEEe-c----------cccEEEEEEcCCCcEE
Confidence 356999999999999999999999999974 12221 2332 1 2679999999999999
Q ss_pred EEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeec
Q 000080 2287 ASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHE 2366 (2389)
Q Consensus 2287 ASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~ 2366 (2389)
|.+=.|+||+++-+.+- +-+.++-||.-+|.++..|| |+++|+|+ |.|++||||-+ .=|.|-++|-+|+
T Consensus 524 aVsLLdnTVkVyflDtl-----KFflsLYGHkLPV~smDIS~-DSklivTg---SADKnVKiWGL--dFGDCHKS~fAHd 592 (888)
T KOG0306|consen 524 AVSLLDNTVKVYFLDTL-----KFFLSLYGHKLPVLSMDISP-DSKLIVTG---SADKNVKIWGL--DFGDCHKSFFAHD 592 (888)
T ss_pred EEEeccCeEEEEEecce-----eeeeeecccccceeEEeccC-CcCeEEec---cCCCceEEecc--ccchhhhhhhccc
Confidence 99999999999999874 67889999999999999999 99999996 69999999998 4588999999999
Q ss_pred CcEEEEeecccc
Q 000080 2367 GLYDLFLPLKLL 2378 (2389)
Q Consensus 2367 ~~V~svA~~~~~ 2378 (2389)
+.|.+|-+.|+-
T Consensus 593 DSvm~V~F~P~~ 604 (888)
T KOG0306|consen 593 DSVMSVQFLPKT 604 (888)
T ss_pred CceeEEEEcccc
Confidence 999999988864
No 95
>KOG1009 consensus Chromatin assembly complex 1 subunit B/CAC2 (contains WD40 repeats) [Chromatin structure and dynamics; Replication, recombination and repair]
Probab=99.26 E-value=1.5e-11 Score=147.21 Aligned_cols=153 Identities=14% Similarity=0.173 Sum_probs=124.8
Q ss_pred eeEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCcee-----eEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCC
Q 000080 2220 ISTRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKAT-----ATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDG 2293 (2389)
Q Consensus 2220 i~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l-----~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~Dg 2293 (2389)
-+|.++.|++++. .||||+.|..||||-+.++..- ..|.. ...+|...|+.|.|+|+|..||||+++|
T Consensus 14 ~pv~s~dfq~n~~~~laT~G~D~~iriW~v~r~~~~~~~~~V~y~s------~Ls~H~~aVN~vRf~p~gelLASg~D~g 87 (434)
T KOG1009|consen 14 EPVYSVDFQKNSLNKLATAGGDKDIRIWKVNRSEPGGGDMKVEYLS------SLSRHTRAVNVVRFSPDGELLASGGDGG 87 (434)
T ss_pred CceEEEEeccCcccceecccCccceeeeeeeecCCCCCceeEEEee------cccCCcceeEEEEEcCCcCeeeecCCCc
Confidence 3568899999988 9999999999999998755421 12210 1346789999999999999999999999
Q ss_pred cEEEeeCC--------CCC---ccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEE
Q 000080 2294 TVCTWQLE--------VGG---RSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASI 2362 (2389)
Q Consensus 2294 TVkLWDl~--------tgg---rs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL 2362 (2389)
.|-||..+ +.. +..-...+.+.+|...|++++|+| |+..++++ +-|+++++||+ ..|+.++.+
T Consensus 88 ~v~lWk~~~~~~~~~d~e~~~~ke~w~v~k~lr~h~~diydL~Ws~-d~~~l~s~---s~dns~~l~Dv--~~G~l~~~~ 161 (434)
T KOG1009|consen 88 EVFLWKQGDVRIFDADTEADLNKEKWVVKKVLRGHRDDIYDLAWSP-DSNFLVSG---SVDNSVRLWDV--HAGQLLAIL 161 (434)
T ss_pred eEEEEEecCcCCccccchhhhCccceEEEEEecccccchhhhhccC-CCceeeee---eccceEEEEEe--ccceeEeec
Confidence 99999776 200 000123466888999999999999 99999986 69999999998 567888999
Q ss_pred EeecCcEEEEeecccchhhhcc
Q 000080 2363 TCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2363 ~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
.+|.+-|.-+|-.|...++.|+
T Consensus 162 ~dh~~yvqgvawDpl~qyv~s~ 183 (434)
T KOG1009|consen 162 DDHEHYVQGVAWDPLNQYVASK 183 (434)
T ss_pred cccccccceeecchhhhhhhhh
Confidence 9999999999999999888775
No 96
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=99.26 E-value=5.4e-11 Score=144.88 Aligned_cols=298 Identities=15% Similarity=0.181 Sum_probs=187.4
Q ss_pred CCCCCCCCcccccccccccCCCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCccccccc--ccccceeeeeccCC
Q 000080 16 CVDPTEHLPLAFLRSEFIPTAPTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEAL--IGPIFRQVFALSDN 93 (2389)
Q Consensus 16 ~~~~~~~lpl~~~~~~~ip~ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~--~~p~~~Qviegh~d 93 (2389)
.++|+-..|.+- ++-=+.+|+.+.|++.-|. | ..++-|+=+--|-.| +|+-+ .=+.|||+.|--.|
T Consensus 148 e~~~~~~IP~sh---Ei~l~hgtk~Vsal~~Dp~--G-aR~~sGs~Dy~v~~w------Df~gMdas~~~fr~l~P~E~h 215 (641)
T KOG0772|consen 148 EESIIKLIPGSH---EIQLKHGTKIVSALAVDPS--G-ARFVSGSLDYTVKFW------DFQGMDASMRSFRQLQPCETH 215 (641)
T ss_pred hhchhhcCCccc---eEeccCCceEEEEeeecCC--C-ceeeeccccceEEEE------ecccccccchhhhccCccccc
Confidence 445555555543 2223456788888888766 8 578888888888888 44321 12669999988777
Q ss_pred CCCeeEEEEcCCCCCCCcEEE-ecCCeEEEEeeCC----CCCCCC-ccceeeEEecccceEEEEeecCCCC-eEEEEecc
Q 000080 94 SLPVTSISWSPETPSIGQLAA-ASENCIFVFAHDS----ASSKGS-FCWSQNAILVQGTKVEAIEWTGSGD-GIVAGGME 166 (2389)
Q Consensus 94 ~~dVk~VaWSPd~~~~GeIaA-SyDntIRVw~~d~----~~~kgd-~~W~~~~tL~hssTV~sIAWSpdG~-rLaSggdD 166 (2389)
+|.+++|||. ++.|++ |..-.++|+.+|. +..+|+ |--....+-.|...+.+-.|.|..+ ..++||.|
T Consensus 216 --~i~sl~ys~T---g~~iLvvsg~aqakl~DRdG~~~~e~~KGDQYI~Dm~nTKGHia~lt~g~whP~~k~~FlT~s~D 290 (641)
T KOG0772|consen 216 --QINSLQYSVT---GDQILVVSGSAQAKLLDRDGFEIVEFSKGDQYIRDMYNTKGHIAELTCGCWHPDNKEEFLTCSYD 290 (641)
T ss_pred --ccceeeecCC---CCeEEEEecCcceeEEccCCceeeeeeccchhhhhhhccCCceeeeeccccccCcccceEEecCC
Confidence 8999999997 677775 5667899998872 112222 1111122334899999999999987 45699998
Q ss_pred --eEEeeccCC-cEEEEEEeeccccc--eEEEEeecCCCc-eEeeecccccccCCC-CCCCceeEEEeeCCCccceeecc
Q 000080 167 --TVLWKKKNT-LWEIAWKFKENYPQ--NLVSATWSIEGP-SATAASMSQLDLLGP-KEAGKCVFICCSDGKSEYIKLEL 239 (2389)
Q Consensus 167 --V~IW~~~~s-~Wecvwt~~~~~~~--~ivsvaWSpdG~-fATag~dikf~~~~~-~~~~kpV~V~~~dg~~~~~~ve~ 239 (2389)
++||+.++. +-..|.+.++++.- ++-+++|+|||+ ||+++.|..++.|.. +-...| .-++..
T Consensus 291 gtlRiWdv~~~k~q~qVik~k~~~g~Rv~~tsC~~nrdg~~iAagc~DGSIQ~W~~~~~~v~p-----------~~~vk~ 359 (641)
T KOG0772|consen 291 GTLRIWDVNNTKSQLQVIKTKPAGGKRVPVTSCAWNRDGKLIAAGCLDGSIQIWDKGSRTVRP-----------VMKVKD 359 (641)
T ss_pred CcEEEEecCCchhheeEEeeccCCCcccCceeeecCCCcchhhhcccCCceeeeecCCccccc-----------ceEeee
Confidence 999996543 34445444444433 344889999999 999999877666521 111122 235678
Q ss_pred cCCC--CeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeecCCccccccccc-CCCCccceeEEEEEEEeec
Q 000080 240 CHPQ--PVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMDSGKTRKVAKDT-NDHKTIRRSFCVGAIIEIN 316 (2389)
Q Consensus 240 aH~q--dVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d~Gk~kk~~~~~-~d~~~~~~sF~vaA~I~~~ 316 (2389)
||.. +|.||.+++ ||+. |+|=+.|+|.|+|+..-.-++=+....- +--+++.|-|..=+-+=+-
T Consensus 360 AH~~g~~Itsi~FS~--------dg~~-----LlSRg~D~tLKvWDLrq~kkpL~~~tgL~t~~~~tdc~FSPd~kli~T 426 (641)
T KOG0772|consen 360 AHLPGQDITSISFSY--------DGNY-----LLSRGFDDTLKVWDLRQFKKPLNVRTGLPTPFPGTDCCFSPDDKLILT 426 (641)
T ss_pred ccCCCCceeEEEecc--------ccch-----hhhccCCCceeeeeccccccchhhhcCCCccCCCCccccCCCceEEEe
Confidence 9986 999999999 6666 9999999999999987532221100000 1123345666544333200
Q ss_pred --ccccCCCCCCeEEEeeccccceeeccCCccceecccccccccceeeeee
Q 000080 317 --QALNGALGMDIVITWAKEIRCMFETGEGANHFISTGVYEHGGTGKCEWL 365 (2389)
Q Consensus 317 --~~~~~~l~~~~~v~W~~~~~~vf~~~~e~~~~~~s~~~~~~~v~~~eW~ 365 (2389)
-..||+--..+++.=.+--+.||+++- ...-|-.|.|+
T Consensus 427 GtS~~~~~~~g~L~f~d~~t~d~v~ki~i-----------~~aSvv~~~Wh 466 (641)
T KOG0772|consen 427 GTSAPNGMTAGTLFFFDRMTLDTVYKIDI-----------STASVVRCLWH 466 (641)
T ss_pred cccccCCCCCceEEEEeccceeeEEEecC-----------CCceEEEEeec
Confidence 112222222344433444455555542 23567889998
No 97
>KOG1407 consensus WD40 repeat protein [Function unknown]
Probab=99.25 E-value=7.1e-11 Score=135.67 Aligned_cols=177 Identities=15% Similarity=0.101 Sum_probs=135.5
Q ss_pred ccccccceeecccccccccccccc--CCCCcCc-eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecc-cCCCC
Q 000080 2189 PGYAGIGASALGWETQDDFEDYVD--PPATVEN-ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGV-LPAAN 2264 (2389)
Q Consensus 2189 ~g~~~~~Asg~~~d~~~~~~~~~d--~~atv~n-i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~v-l~gh~ 2264 (2389)
|-+-+..|+. .-++..++|++.. +.+.+++ ..=.-++|+|+|.+++.|+.|-.|..-|.++-+.+.+++. ...+.
T Consensus 74 ~~~~d~~ata-s~dk~ir~wd~r~~k~~~~i~~~~eni~i~wsp~g~~~~~~~kdD~it~id~r~~~~~~~~~~~~e~ne 152 (313)
T KOG1407|consen 74 PKHPDLFATA-SGDKTIRIWDIRSGKCTARIETKGENINITWSPDGEYIAVGNKDDRITFIDARTYKIVNEEQFKFEVNE 152 (313)
T ss_pred CCCCcceEEe-cCCceEEEEEeccCcEEEEeeccCcceEEEEcCCCCEEEEecCcccEEEEEecccceeehhcccceeee
Confidence 4445566666 5588899998862 2222222 1113569999999999999999999999876655433210 00000
Q ss_pred ------------------------------CCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceee
Q 000080 2265 ------------------------------VPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESC 2314 (2389)
Q Consensus 2265 ------------------------------~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl 2314 (2389)
.....|...-.+|.|+|+|++||+||.|-.|.|||++.- -+.+.+
T Consensus 153 ~~w~~~nd~Fflt~GlG~v~ILsypsLkpv~si~AH~snCicI~f~p~GryfA~GsADAlvSLWD~~EL-----iC~R~i 227 (313)
T KOG1407|consen 153 ISWNNSNDLFFLTNGLGCVEILSYPSLKPVQSIKAHPSNCICIEFDPDGRYFATGSADALVSLWDVDEL-----ICERCI 227 (313)
T ss_pred eeecCCCCEEEEecCCceEEEEeccccccccccccCCcceEEEEECCCCceEeeccccceeeccChhHh-----hhheee
Confidence 013457788889999999999999999999999999853 567777
Q ss_pred eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080 2315 LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus 2315 ~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
.-|.-+|+.+.||. ||++|||| |+|.-|-|=++ ++|..++.++ |++...+||-+|+-
T Consensus 228 sRldwpVRTlSFS~-dg~~lASa---SEDh~IDIA~v--etGd~~~eI~-~~~~t~tVAWHPk~ 284 (313)
T KOG1407|consen 228 SRLDWPVRTLSFSH-DGRMLASA---SEDHFIDIAEV--ETGDRVWEIP-CEGPTFTVAWHPKR 284 (313)
T ss_pred ccccCceEEEEecc-Ccceeecc---CccceEEeEec--ccCCeEEEee-ccCCceeEEecCCC
Confidence 88999999999999 99999997 79999999887 7888899988 88889999988863
No 98
>KOG2445 consensus Nuclear pore complex component (sc Seh1) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=99.23 E-value=6e-10 Score=130.33 Aligned_cols=264 Identities=17% Similarity=0.261 Sum_probs=170.4
Q ss_pred eccCCCCCeeEEEEcCCCCCCCcEEE-ecCCeEEEEeeCCCCCCCCccceeeEEec-ccceEEEEeecCC--CCeEEEEe
Q 000080 89 ALSDNSLPVTSISWSPETPSIGQLAA-ASENCIFVFAHDSASSKGSFCWSQNAILV-QGTKVEAIEWTGS--GDGIVAGG 164 (2389)
Q Consensus 89 egh~d~~dVk~VaWSPd~~~~GeIaA-SyDntIRVw~~d~~~~kgd~~W~~~~tL~-hssTV~sIAWSpd--G~rLaSgg 164 (2389)
.+|+| -|.+|.|-+. |..+|+ |+|.+|+||..+ +++-.|.|+..-. |++.||.|.|-+- |+-+|+|+
T Consensus 10 s~h~D--lihdVs~D~~---GRRmAtCSsDq~vkI~d~~----~~s~~W~~Ts~Wrah~~Si~rV~WAhPEfGqvvA~cS 80 (361)
T KOG2445|consen 10 SGHKD--LIHDVSFDFY---GRRMATCSSDQTVKIWDST----SDSGTWSCTSSWRAHDGSIWRVVWAHPEFGQVVATCS 80 (361)
T ss_pred cCCcc--eeeeeeeccc---CceeeeccCCCcEEEEecc----CCCCceEEeeeEEecCCcEEEEEecCccccceEEEEe
Confidence 56777 7999999997 666775 579999999954 2334799988884 9999999999875 89999999
Q ss_pred cc--eEEeec-------cCCcEEEEEEeeccccceEEEEeecCC--Cc-eEeeecccc---cccCCCCCCCceeEEEeeC
Q 000080 165 ME--TVLWKK-------KNTLWEIAWKFKENYPQNLVSATWSIE--GP-SATAASMSQ---LDLLGPKEAGKCVFICCSD 229 (2389)
Q Consensus 165 dD--V~IW~~-------~~s~Wecvwt~~~~~~~~ivsvaWSpd--G~-fATag~dik---f~~~~~~~~~kpV~V~~~d 229 (2389)
.| +.||.. ....|...+++. +....+++|.++|- |. +|+|+.|.- |+.-+..+- .-|-. .
T Consensus 81 ~Drtv~iWEE~~~~~~~~~~~Wv~~ttl~-DsrssV~DV~FaP~hlGLklA~~~aDG~lRIYEA~dp~nL--s~W~L--q 155 (361)
T KOG2445|consen 81 YDRTVSIWEEQEKSEEAHGRRWVRRTTLV-DSRSSVTDVKFAPKHLGLKLAAASADGILRIYEAPDPMNL--SQWTL--Q 155 (361)
T ss_pred cCCceeeeeecccccccccceeEEEEEee-cCCcceeEEEecchhcceEEEEeccCcEEEEEecCCcccc--ccchh--h
Confidence 98 999996 224798888765 34456789999994 88 999999654 332211111 11211 1
Q ss_pred CCcc-ceeecccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecC-----CeEEEEEeecCC-ccccccc--ccCC-
Q 000080 230 GKSE-YIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLD-----GTVRLWCEMDSG-KTRKVAK--DTND- 299 (2389)
Q Consensus 230 g~~~-~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdD-----gTVRLW~e~d~G-k~kk~~~--~~~d- 299 (2389)
.+.+ .......|.++-.||.|+|+ +| .+..||-+|++ +.++||...++| |.+|-++ +..|
T Consensus 156 ~Ei~~~~~pp~~~~~~~~CvsWn~s--r~--------~~p~iAvgs~e~a~~~~~~~Iye~~e~~rKw~kva~L~d~~dp 225 (361)
T KOG2445|consen 156 HEIQNVIDPPGKNKQPCFCVSWNPS--RM--------HEPLIAVGSDEDAPHLNKVKIYEYNENGRKWLKVAELPDHTDP 225 (361)
T ss_pred hhhhhccCCcccccCcceEEeeccc--cc--------cCceEEEEcccCCccccceEEEEecCCcceeeeehhcCCCCCc
Confidence 1111 11123568899999999984 33 45568888888 689999999998 6655332 2222
Q ss_pred ------CCccceeEEEEEEEeecccccCCCCCCeEEEeeccccceeeccCCccc-------eecccccccc-cceeeeee
Q 000080 300 ------HKTIRRSFCVGAIIEINQALNGALGMDIVITWAKEIRCMFETGEGANH-------FISTGVYEHG-GTGKCEWL 365 (2389)
Q Consensus 300 ------~~~~~~sF~vaA~I~~~~~~~~~l~~~~~v~W~~~~~~vf~~~~e~~~-------~~~s~~~~~~-~v~~~eW~ 365 (2389)
-++.+++||++|+-- ..| .++ |.|.=+ -+-++.-+.+++. ...++.-+|. +|=.++|+
T Consensus 226 I~di~wAPn~Gr~y~~lAvA~----kDg-v~I-~~v~~~--~s~i~~ee~~~~~~~~~l~v~~vs~~~~H~~~VWrv~wN 297 (361)
T KOG2445|consen 226 IRDISWAPNIGRSYHLLAVAT----KDG-VRI-FKVKVA--RSAIEEEEVLAPDLMTDLPVEKVSELDDHNGEVWRVRWN 297 (361)
T ss_pred ceeeeeccccCCceeeEEEee----cCc-EEE-EEEeec--cchhhhhcccCCCCccccceEEeeeccCCCCceEEEEEe
Confidence 346799999999965 444 211 222110 0111111111111 1123344664 88899998
Q ss_pred ------EeecCCccceeEEEeeecc
Q 000080 366 ------VGYGPGSLVTLWAIHCLDD 384 (2389)
Q Consensus 366 ------~~~~PGs~l~~W~v~~LDd 384 (2389)
.+-|--..+++|..-+-|.
T Consensus 298 mtGtiLsStGdDG~VRLWkany~n~ 322 (361)
T KOG2445|consen 298 MTGTILSSTGDDGCVRLWKANYNNL 322 (361)
T ss_pred eeeeEEeecCCCceeeehhhhhhhh
Confidence 3444434556777666554
No 99
>KOG0302 consensus Ribosome Assembly protein [General function prediction only]
Probab=99.23 E-value=4.3e-11 Score=142.11 Aligned_cols=147 Identities=19% Similarity=0.252 Sum_probs=117.3
Q ss_pred EEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeC
Q 000080 2223 RAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2223 rsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl 2300 (2389)
.+++|||--. .|+||-.-+.|++|...+|.=... ..|..||+..|-.+++||.- ..|||||.||+|||||+
T Consensus 215 y~LdWSp~~~g~LlsGDc~~~I~lw~~~~g~W~vd-------~~Pf~gH~~SVEDLqWSptE~~vfaScS~DgsIrIWDi 287 (440)
T KOG0302|consen 215 YGLDWSPIKTGRLLSGDCVKGIHLWEPSTGSWKVD-------QRPFTGHTKSVEDLQWSPTEDGVFASCSCDGSIRIWDI 287 (440)
T ss_pred eeeecccccccccccCccccceEeeeeccCceeec-------CccccccccchhhhccCCccCceEEeeecCceEEEEEe
Confidence 6789999322 478888888999999988753221 23678899999999999984 79999999999999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCC-CCCCceEEEEeecCcEEEEeecc--c
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLA-PPTSSRASITCHEGLYDLFLPLK--L 2377 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~-~tg~~v~sL~GH~~~V~svA~~~--~ 2377 (2389)
+.+.+ ++......|.+-|+-|.|+. .-.+|||| ++|||++|||+.. ..++.|..|.-|...|+||..+| +
T Consensus 288 Rs~~~---~~~~~~kAh~sDVNVISWnr-~~~lLasG---~DdGt~~iwDLR~~~~~~pVA~fk~Hk~pItsieW~p~e~ 360 (440)
T KOG0302|consen 288 RSGPK---KAAVSTKAHNSDVNVISWNR-REPLLASG---GDDGTLSIWDLRQFKSGQPVATFKYHKAPITSIEWHPHED 360 (440)
T ss_pred cCCCc---cceeEeeccCCceeeEEccC-Ccceeeec---CCCceEEEEEhhhccCCCcceeEEeccCCeeEEEeccccC
Confidence 98732 34444488999999999998 55699996 4999999999852 34456899999999999998776 4
Q ss_pred chhhhc
Q 000080 2378 LNFALS 2383 (2389)
Q Consensus 2378 ~~~~~s 2383 (2389)
..+|.|
T Consensus 361 s~iaas 366 (440)
T KOG0302|consen 361 SVIAAS 366 (440)
T ss_pred ceEEec
Confidence 444443
No 100
>KOG1064 consensus RAVE (regulator of V-ATPase assembly) complex subunit RAV1/DMX protein, WD repeat superfamily [General function prediction only]
Probab=99.23 E-value=1.4e-08 Score=136.04 Aligned_cols=193 Identities=11% Similarity=0.131 Sum_probs=140.3
Q ss_pred CCCCCCCCCcccccccccccCCCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCC
Q 000080 15 PCVDPTEHLPLAFLRSEFIPTAPTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNS 94 (2389)
Q Consensus 15 ~~~~~~~~lpl~~~~~~~ip~ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~ 94 (2389)
+++.-++++|+..-.+..-++.++.+-.++.|.|+++...|.+||..|...+-.|+.+..+...+.+|++ +.+....
T Consensus 18 y~~gsi~~~pftay~sg~~vvIl~n~fervQiIp~~~~g~~~vsav~c~~~tG~IA~sygn~v~I~eP~~--i~s~k~n- 94 (2439)
T KOG1064|consen 18 YSVGSIGDLPFTAYASGCDVVILTNDFERVQIIPGAKHGNILVSAVDCSQQTGKIAASYGNVVSIFEPTN--ILSSKGN- 94 (2439)
T ss_pred ceeceECCeeEEEeecCCceEEEcCCceeEEeccccCcCceEEEEEeeccccceeeeccCCeeeecCCcc--hhhhcCC-
Confidence 4666799999999999999999999999999999998878999999999999999999999888889998 2222222
Q ss_pred CCeeEEEEcCCCCCCCcE-------------EEecCCeEEEEeeCC-------C-CC----CCCccceeeEEecccceEE
Q 000080 95 LPVTSISWSPETPSIGQL-------------AAASENCIFVFAHDS-------A-SS----KGSFCWSQNAILVQGTKVE 149 (2389)
Q Consensus 95 ~dVk~VaWSPd~~~~GeI-------------aASyDntIRVw~~d~-------~-~~----kgd~~W~~~~tL~hssTV~ 149 (2389)
++..+.|.+.|+..++. ++.+++.+.+|.+-. + -+ ...-+|.+.++......|-
T Consensus 95 -~~~~~~W~~t~qf~~~~~~~s~~w~~~~~rlltgs~~l~Lwq~~~~~~~~~~~~i~d~~l~~~~~We~iW~~k~~~~v~ 173 (2439)
T KOG1064|consen 95 -PHLAVQWVQTTQFFHDSTVVSLNWNFEGLRLLTGSDNLQLWQETINFSIEEPEEITDTVLPKRRDWELIWSCKTPSPVY 173 (2439)
T ss_pred -cceeeeEEeeecccccccceeeeeccccchhhhcCcceEEEeccCCcccccccccccccccccccceEEEeccCCccee
Confidence 33444444443333332 223357888995421 0 00 0112588888877777799
Q ss_pred EEeecCCCCeEEEEecc---eEEeeccC-------CcEEEEEEeeccccceEEEEeec------CCCc----eEeeeccc
Q 000080 150 AIEWTGSGDGIVAGGME---TVLWKKKN-------TLWEIAWKFKENYPQNLVSATWS------IEGP----SATAASMS 209 (2389)
Q Consensus 150 sIAWSpdG~rLaSggdD---V~IW~~~~-------s~Wecvwt~~~~~~~~ivsvaWS------pdG~----fATag~di 209 (2389)
.+.|||||.++|++|.+ +++|.+.+ ..+.. +...||+.|--+.|. |.|. +-|||-|.
T Consensus 174 ~~~~SpDG~f~at~g~~dclaKvwy~~~~~~~~~~~~f~~---vyL~HP~~Vs~~~WRktskymp~gsv~nvL~T~C~D~ 250 (2439)
T KOG1064|consen 174 SSTISPDGEFFATIGKRDCLAKVWYKSTVSQSGGEESFSF---VYLPHPRRVSGFQWRKTSKYMPRGSVSNVLMTCCLDN 250 (2439)
T ss_pred EEEEcCCcceEEeccccCcchhhhcccccccccCccceee---EeccCCcccccceeccccccCCccchhhhHHhhhccC
Confidence 99999999999999996 89999421 22333 357899988888888 5554 77787765
Q ss_pred ccccC
Q 000080 210 QLDLL 214 (2389)
Q Consensus 210 kf~~~ 214 (2389)
..++|
T Consensus 251 v~RIW 255 (2439)
T KOG1064|consen 251 VCRIW 255 (2439)
T ss_pred ceEEE
Confidence 53443
No 101
>KOG0646 consensus WD40 repeat protein [General function prediction only]
Probab=99.23 E-value=5.7e-11 Score=144.02 Aligned_cols=152 Identities=22% Similarity=0.316 Sum_probs=125.2
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
..|.+++-+|+|.+|+.|..-+.|+||.+.+|..+.++. +| =..|+++.|+-||..|.|||.||.|.+|+
T Consensus 82 g~v~al~s~n~G~~l~ag~i~g~lYlWelssG~LL~v~~---aH-------YQ~ITcL~fs~dgs~iiTgskDg~V~vW~ 151 (476)
T KOG0646|consen 82 GPVHALASSNLGYFLLAGTISGNLYLWELSSGILLNVLS---AH-------YQSITCLKFSDDGSHIITGSKDGAVLVWL 151 (476)
T ss_pred cceeeeecCCCceEEEeecccCcEEEEEeccccHHHHHH---hh-------ccceeEEEEeCCCcEEEecCCCccEEEEE
Confidence 347999999999999999899999999999999988774 44 47899999999999999999999999998
Q ss_pred CCCCC----ccCcccceeeeecCCCeeEEEEecC-CCCEEEEeecCCCCCeEEEeeC-----------------------
Q 000080 2300 LEVGG----RSNVRPMESCLCFSSHAMDVSYITS-SGSVIAAAGHSSNGINVVVWDT----------------------- 2351 (2389)
Q Consensus 2300 l~tgg----rs~~k~l~tl~gHs~~V~sVAFSP~-DGslLASAG~sS~D~TVrLWD~----------------------- 2351 (2389)
+.+-- ...++|+..+..|.-.|.++-..++ ...+|+|+ |.|+|+|+||+
T Consensus 152 l~~lv~a~~~~~~~p~~~f~~HtlsITDl~ig~Gg~~~rl~Ta---S~D~t~k~wdlS~g~LLlti~fp~si~av~lDpa 228 (476)
T KOG0646|consen 152 LTDLVSADNDHSVKPLHIFSDHTLSITDLQIGSGGTNARLYTA---SEDRTIKLWDLSLGVLLLTITFPSSIKAVALDPA 228 (476)
T ss_pred EEeecccccCCCccceeeeccCcceeEEEEecCCCccceEEEe---cCCceEEEEEeccceeeEEEecCCcceeEEEccc
Confidence 74310 0146789999999999999877763 33678887 69999999995
Q ss_pred --------------------CC------------CCCCceEEEEeecC--cEEEEeecccchhhhcc
Q 000080 2352 --------------------LA------------PPTSSRASITCHEG--LYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2352 --------------------l~------------~tg~~v~sL~GH~~--~V~svA~~~~~~~~~s~ 2384 (2389)
.. ..+..++.+.||++ .|+|+|.+.||.-.+|-
T Consensus 229 e~~~yiGt~~G~I~~~~~~~~~~~~~~v~~k~~~~~~t~~~~~~Gh~~~~~ITcLais~DgtlLlSG 295 (476)
T KOG0646|consen 229 ERVVYIGTEEGKIFQNLLFKLSGQSAGVNQKGRHEENTQINVLVGHENESAITCLAISTDGTLLLSG 295 (476)
T ss_pred ccEEEecCCcceEEeeehhcCCcccccccccccccccceeeeeccccCCcceeEEEEecCccEEEee
Confidence 01 12334667899999 99999999999877763
No 102
>KOG0301 consensus Phospholipase A2-activating protein (contains WD40 repeats) [Lipid transport and metabolism]
Probab=99.22 E-value=4.1e-11 Score=149.78 Aligned_cols=132 Identities=12% Similarity=0.139 Sum_probs=110.6
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
-+++-.-++. ++|||.|.|+|+|-. |++..+++ ||.+.|++|++=|++ .++|||.|.|||+|.-.
T Consensus 105 C~ls~~~~~~-~iSgSWD~TakvW~~--~~l~~~l~----------gH~asVWAv~~l~e~-~~vTgsaDKtIklWk~~- 169 (745)
T KOG0301|consen 105 CSLSIGEDGT-LISGSWDSTAKVWRI--GELVYSLQ----------GHTASVWAVASLPEN-TYVTGSADKTIKLWKGG- 169 (745)
T ss_pred eeeecCCcCc-eEecccccceEEecc--hhhhcccC----------CcchheeeeeecCCC-cEEeccCcceeeeccCC-
Confidence 5666666666 999999999999986 57776652 577999999999998 99999999999999653
Q ss_pred CCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhh
Q 000080 2303 GGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus 2303 ggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
+.+.++.||++.|+.+++.+ ++.+| |+ +.|+.||+||+ ++.++....||++-|.+++....+.-++
T Consensus 170 ------~~l~tf~gHtD~VRgL~vl~-~~~fl-Sc---sNDg~Ir~w~~---~ge~l~~~~ghtn~vYsis~~~~~~~Iv 235 (745)
T KOG0301|consen 170 ------TLLKTFSGHTDCVRGLAVLD-DSHFL-SC---SNDGSIRLWDL---DGEVLLEMHGHTNFVYSISMALSDGLIV 235 (745)
T ss_pred ------chhhhhccchhheeeeEEec-CCCeE-ee---cCCceEEEEec---cCceeeeeeccceEEEEEEecCCCCeEE
Confidence 46788999999999999998 65655 65 59999999997 6899999999999999999555555444
Q ss_pred c
Q 000080 2383 S 2383 (2389)
Q Consensus 2383 s 2383 (2389)
|
T Consensus 236 s 236 (745)
T KOG0301|consen 236 S 236 (745)
T ss_pred E
Confidence 4
No 103
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=99.22 E-value=1.1e-10 Score=138.48 Aligned_cols=145 Identities=14% Similarity=0.222 Sum_probs=117.3
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
.=+.|||-+++|+.|+.||.|-+|.+.++...+.|. ||...+++=.|.|||+++++|..||||++||+.+
T Consensus 152 eWl~WHp~a~illAG~~DGsvWmw~ip~~~~~kv~~----------Gh~~~ct~G~f~pdGKr~~tgy~dgti~~Wn~kt 221 (399)
T KOG0296|consen 152 EWLKWHPRAHILLAGSTDGSVWMWQIPSQALCKVMS----------GHNSPCTCGEFIPDGKRILTGYDDGTIIVWNPKT 221 (399)
T ss_pred EEEEecccccEEEeecCCCcEEEEECCCcceeeEec----------CCCCCcccccccCCCceEEEEecCceEEEEecCC
Confidence 446999999999999999999999998876666662 5678899999999999999999999999999988
Q ss_pred CCc-----------------------------------------------------------------------------
Q 000080 2303 GGR----------------------------------------------------------------------------- 2305 (2389)
Q Consensus 2303 ggr----------------------------------------------------------------------------- 2305 (2389)
+..
T Consensus 222 g~p~~~~~~~e~~~~~~~~~~~~~~~~~~g~~e~~~~~~~~~sgKVv~~~n~~~~~l~~~~e~~~esve~~~~ss~lpL~ 301 (399)
T KOG0296|consen 222 GQPLHKITQAEGLELPCISLNLAGSTLTKGNSEGVACGVNNGSGKVVNCNNGTVPELKPSQEELDESVESIPSSSKLPLA 301 (399)
T ss_pred CceeEEecccccCcCCccccccccceeEeccCCccEEEEccccceEEEecCCCCccccccchhhhhhhhhcccccccchh
Confidence 621
Q ss_pred -------------cCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEE
Q 000080 2306 -------------SNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLF 2372 (2389)
Q Consensus 2306 -------------s~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~sv 2372 (2389)
.....++..-.|+..|..+-|.+ + .+|+|+ +.|++||+||. .+|+++..+.||..+|.++
T Consensus 302 A~G~vdG~i~iyD~a~~~~R~~c~he~~V~~l~w~~-t-~~l~t~---c~~g~v~~wDa--RtG~l~~~y~GH~~~Il~f 374 (399)
T KOG0296|consen 302 ACGSVDGTIAIYDLAASTLRHICEHEDGVTKLKWLN-T-DYLLTA---CANGKVRQWDA--RTGQLKFTYTGHQMGILDF 374 (399)
T ss_pred hcccccceEEEEecccchhheeccCCCceEEEEEcC-c-chheee---ccCceEEeeec--cccceEEEEecCchheeEE
Confidence 00001111123777788888887 4 556654 58889999997 5899999999999999999
Q ss_pred eecccchhhhcc
Q 000080 2373 LPLKLLNFALSK 2384 (2389)
Q Consensus 2373 A~~~~~~~~~s~ 2384 (2389)
+.+|++++.++-
T Consensus 375 ~ls~~~~~vvT~ 386 (399)
T KOG0296|consen 375 ALSPQKRLVVTV 386 (399)
T ss_pred EEcCCCcEEEEe
Confidence 999999998863
No 104
>KOG0294 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.20 E-value=9.2e-11 Score=137.29 Aligned_cols=137 Identities=20% Similarity=0.249 Sum_probs=112.1
Q ss_pred EEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCC--EEEEEeCCCcEEEee
Q 000080 2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGH--RFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~--~LASgS~DgTVkLWD 2299 (2389)
+.+||. +|+++||||.|-||+|||..+.+++.++- -|.+.|+++.|.|+-. .|.||++||.|.+|+
T Consensus 46 itavAV--s~~~~aSGssDetI~IYDm~k~~qlg~ll----------~HagsitaL~F~~~~S~shLlS~sdDG~i~iw~ 113 (362)
T KOG0294|consen 46 ITALAV--SGPYVASGSSDETIHIYDMRKRKQLGILL----------SHAGSITALKFYPPLSKSHLLSGSDDGHIIIWR 113 (362)
T ss_pred eeEEEe--cceeEeccCCCCcEEEEeccchhhhccee----------ccccceEEEEecCCcchhheeeecCCCcEEEEE
Confidence 366666 58999999999999999998888877763 2678999999999975 999999999999999
Q ss_pred CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCc--eEEEEeecCcEEEEeeccc
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSS--RASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~--v~sL~GH~~~V~svA~~~~ 2377 (2389)
+..- ..+.++.+|.+.|++++.+| +|++-.|.| .|+++|+||+. .|+. +..|. | ..+.|.++|+
T Consensus 114 ~~~W-----~~~~slK~H~~~Vt~lsiHP-S~KLALsVg---~D~~lr~WNLV--~Gr~a~v~~L~-~--~at~v~w~~~ 179 (362)
T KOG0294|consen 114 VGSW-----ELLKSLKAHKGQVTDLSIHP-SGKLALSVG---GDQVLRTWNLV--RGRVAFVLNLK-N--KATLVSWSPQ 179 (362)
T ss_pred cCCe-----EEeeeecccccccceeEecC-CCceEEEEc---CCceeeeehhh--cCccceeeccC-C--cceeeEEcCC
Confidence 9865 47788999999999999999 999888875 89999999985 3333 33332 2 2445889999
Q ss_pred ch-hhhcc
Q 000080 2378 LN-FALSK 2384 (2389)
Q Consensus 2378 ~~-~~~s~ 2384 (2389)
|+ |+++-
T Consensus 180 Gd~F~v~~ 187 (362)
T KOG0294|consen 180 GDHFVVSG 187 (362)
T ss_pred CCEEEEEe
Confidence 98 76653
No 105
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.20 E-value=4.5e-11 Score=144.70 Aligned_cols=144 Identities=16% Similarity=0.171 Sum_probs=117.7
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEec----ccCCCCCC--CC--CCCCCEEEEEECCCCCEEEEEeC
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYG----VLPAANVP--PP--YALASISALQFDHYGHRFASAAL 2291 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~----vl~gh~~p--~~--GH~~~V~sVaFSPDG~~LASgS~ 2291 (2389)
.++.+++++||..+..++|-|++|-=|++.+|+-.+-.. ++..|.+| ++ +|...|.+++.||||++||+|+.
T Consensus 143 ~s~~~vals~d~~~~fsask~g~i~kw~v~tgk~~~~i~~~~ev~k~~~~~~k~~r~~h~keil~~avS~Dgkylatgg~ 222 (479)
T KOG0299|consen 143 LSVTSVALSPDDKRVFSASKDGTILKWDVLTGKKDRYIIERDEVLKSHGNPLKESRKGHVKEILTLAVSSDGKYLATGGR 222 (479)
T ss_pred CcceEEEeeccccceeecCCCcceeeeehhcCcccccccccchhhhhccCCCCcccccccceeEEEEEcCCCcEEEecCC
Confidence 456899999999999999999999999999998542111 11224443 23 78899999999999999999999
Q ss_pred CCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEE
Q 000080 2292 DGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDL 2371 (2389)
Q Consensus 2292 DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~s 2371 (2389)
|..|.|||..+. .++..+.+|.+.|.+++|--+..+++ ++ |.|++|++|++ .+-..+.+|.||++.|..
T Consensus 223 d~~v~Iw~~~t~-----ehv~~~~ghr~~V~~L~fr~gt~~ly-s~---s~Drsvkvw~~--~~~s~vetlyGHqd~v~~ 291 (479)
T KOG0299|consen 223 DRHVQIWDCDTL-----EHVKVFKGHRGAVSSLAFRKGTSELY-SA---SADRSVKVWSI--DQLSYVETLYGHQDGVLG 291 (479)
T ss_pred CceEEEecCccc-----chhhcccccccceeeeeeecCcccee-ee---ecCCceEEEeh--hHhHHHHHHhCCccceee
Confidence 999999999986 46777899999999999997554555 44 58999999998 344458899999999998
Q ss_pred Eee
Q 000080 2372 FLP 2374 (2389)
Q Consensus 2372 vA~ 2374 (2389)
|.-
T Consensus 292 Ida 294 (479)
T KOG0299|consen 292 IDA 294 (479)
T ss_pred ech
Confidence 874
No 106
>KOG1446 consensus Histone H3 (Lys4) methyltransferase complex and RNA cleavage factor II complex, subunit SWD2 [RNA processing and modification; Chromatin structure and dynamics; Posttranslational modification, protein turnover, chaperones]
Probab=99.19 E-value=2.9e-10 Score=133.49 Aligned_cols=151 Identities=15% Similarity=0.085 Sum_probs=115.0
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC--------C-------------------------
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV--------P------------------------- 2266 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~--------p------------------------- 2266 (2389)
.+|.+|.||++|..++++++|-+++|+|..+|+++++... +-+.+ +
T Consensus 15 ~~i~sl~fs~~G~~litss~dDsl~LYd~~~g~~~~ti~s-kkyG~~~~~Fth~~~~~i~sStk~d~tIryLsl~dNkyl 93 (311)
T KOG1446|consen 15 GKINSLDFSDDGLLLITSSEDDSLRLYDSLSGKQVKTINS-KKYGVDLACFTHHSNTVIHSSTKEDDTIRYLSLHDNKYL 93 (311)
T ss_pred CceeEEEecCCCCEEEEecCCCeEEEEEcCCCceeeEeec-ccccccEEEEecCCceEEEccCCCCCceEEEEeecCceE
Confidence 4568999999999999999999999999999998876531 10000 0
Q ss_pred --CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCC
Q 000080 2267 --PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGI 2344 (2389)
Q Consensus 2267 --~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~ 2344 (2389)
.+||...|.++.-+|-+..|.|+|.|+||||||+++.. +.--+ +...-.-+||.| .|-++|.| ....
T Consensus 94 RYF~GH~~~V~sL~~sP~~d~FlS~S~D~tvrLWDlR~~~-----cqg~l--~~~~~pi~AfDp-~GLifA~~---~~~~ 162 (311)
T KOG1446|consen 94 RYFPGHKKRVNSLSVSPKDDTFLSSSLDKTVRLWDLRVKK-----CQGLL--NLSGRPIAAFDP-EGLIFALA---NGSE 162 (311)
T ss_pred EEcCCCCceEEEEEecCCCCeEEecccCCeEEeeEecCCC-----CceEE--ecCCCcceeECC-CCcEEEEe---cCCC
Confidence 78999999999999999999999999999999999752 21111 222333589999 99999885 3444
Q ss_pred eEEEeeCCCCCCCceEEEE---eecCcEEEEeecccchhhh
Q 000080 2345 NVVVWDTLAPPTSSRASIT---CHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus 2345 TVrLWD~l~~tg~~v~sL~---GH~~~V~svA~~~~~~~~~ 2382 (2389)
.|+|+|+..-.....+++. +-..+.+.+-+|++|..+|
T Consensus 163 ~IkLyD~Rs~dkgPF~tf~i~~~~~~ew~~l~FS~dGK~iL 203 (311)
T KOG1446|consen 163 LIKLYDLRSFDKGPFTTFSITDNDEAEWTDLEFSPDGKSIL 203 (311)
T ss_pred eEEEEEecccCCCCceeEccCCCCccceeeeEEcCCCCEEE
Confidence 9999998543334444443 3466788999999998876
No 107
>KOG0300 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.18 E-value=4.4e-11 Score=138.99 Aligned_cols=175 Identities=15% Similarity=0.196 Sum_probs=136.7
Q ss_pred cccccceeeccccccccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCC
Q 000080 2190 GYAGIGASALGWETQDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPY 2269 (2389)
Q Consensus 2190 g~~~~~Asg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~G 2269 (2389)
|++....+.|-..+ ..+.-......+-++| +.|+-....+++.++|.|.|.+||.+++|+|+.+|+ |
T Consensus 122 a~tsrivssFk~~t-~~~~lvre~~GHkDGi--W~Vaa~~tqpi~gtASADhTA~iWs~Esg~CL~~Y~----------G 188 (481)
T KOG0300|consen 122 APTSRIVSSFKDGT-VKFRLVRELEGHKDGI--WHVAADSTQPICGTASADHTARIWSLESGACLATYT----------G 188 (481)
T ss_pred CCcchheeeecCCc-eeEeehhhhcccccce--eeehhhcCCcceeecccccceeEEeeccccceeeec----------c
Confidence 44455555544222 2222222334445544 999999999999999999999999999999999994 6
Q ss_pred CCCCEEEEEECCCCCEEEEEeCCCcEEEeeCC----CCC---------------------------cc----Ccccceee
Q 000080 2270 ALASISALQFDHYGHRFASAALDGTVCTWQLE----VGG---------------------------RS----NVRPMESC 2314 (2389)
Q Consensus 2270 H~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~----tgg---------------------------rs----~~k~l~tl 2314 (2389)
|.+.|.+|+|+|.|..+++||+|+|-.||... +.. ++ .-.|+..+
T Consensus 189 H~GSVNsikfh~s~~L~lTaSGD~taHIW~~av~~~vP~~~a~~~hSsEeE~e~sDe~~~d~d~~~~sD~~tiRvPl~~l 268 (481)
T KOG0300|consen 189 HTGSVNSIKFHNSGLLLLTASGDETAHIWKAAVNWEVPSNNAPSDHSSEEEEEHSDEHNRDTDSSEKSDGHTIRVPLMRL 268 (481)
T ss_pred cccceeeEEeccccceEEEccCCcchHHHHHhhcCcCCCCCCCCCCCchhhhhcccccccccccccccCCceeeeeeeee
Confidence 88999999999999999999999999999721 100 00 11367789
Q ss_pred eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080 2315 LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2315 ~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
.||.+.|.+..|.. .|+.++|| |.|+|.-|||+ .++..++.|.||+...+-++-+|--+-.|.
T Consensus 269 tgH~~vV~a~dWL~-gg~Q~vTa---SWDRTAnlwDV--Etge~v~~LtGHd~ELtHcstHptQrLVvT 331 (481)
T KOG0300|consen 269 TGHRAVVSACDWLA-GGQQMVTA---SWDRTANLWDV--ETGEVVNILTGHDSELTHCSTHPTQRLVVT 331 (481)
T ss_pred eccccceEehhhhc-Ccceeeee---eccccceeeee--ccCceeccccCcchhccccccCCcceEEEE
Confidence 99999999999998 89999997 69999999998 688889999999999887777776655544
No 108
>KOG0288 consensus WD40 repeat protein TipD [General function prediction only]
Probab=99.18 E-value=2.8e-11 Score=144.94 Aligned_cols=171 Identities=16% Similarity=0.127 Sum_probs=136.8
Q ss_pred ccc-ccceeeccccccccccccccC----CCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCC
Q 000080 2190 GYA-GIGASALGWETQDDFEDYVDP----PATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPA 2262 (2389)
Q Consensus 2190 g~~-~~~Asg~~~d~~~~~~~~~d~----~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~g 2262 (2389)
++. +.+|+| |-|..+.+|...-. ..++.+ ..|.++.|.++++.++++|.|+++++|++.+++...||.
T Consensus 184 l~~sdtlatg-g~Dr~Ik~W~v~~~k~~~~~tLaGs~g~it~~d~d~~~~~~iAas~d~~~r~Wnvd~~r~~~TLs---- 258 (459)
T KOG0288|consen 184 LRNSDTLATG-GSDRIIKLWNVLGEKSELISTLAGSLGNITSIDFDSDNKHVIAASNDKNLRLWNVDSLRLRHTLS---- 258 (459)
T ss_pred ccCcchhhhc-chhhhhhhhhcccchhhhhhhhhccCCCcceeeecCCCceEEeecCCCceeeeeccchhhhhhhc----
Confidence 444 677888 88888999987532 233332 357999999999999999999999999999999999984
Q ss_pred CCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCC
Q 000080 2263 ANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSN 2342 (2389)
Q Consensus 2263 h~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~ 2342 (2389)
||++.|+++.|.-.-...++|+.|.|||+||+..+ .+..+.. ....+++|+-++ ..++| | -.
T Consensus 259 ------GHtdkVt~ak~~~~~~~vVsgs~DRtiK~WDl~k~-----~C~kt~l-~~S~cnDI~~~~---~~~~S-g--H~ 320 (459)
T KOG0288|consen 259 ------GHTDKVTAAKFKLSHSRVVSGSADRTIKLWDLQKA-----YCSKTVL-PGSQCNDIVCSI---SDVIS-G--HF 320 (459)
T ss_pred ------ccccceeeehhhccccceeeccccchhhhhhhhhh-----heecccc-ccccccceEecc---eeeee-c--cc
Confidence 68899999999998888999999999999999875 2333332 235678888875 45666 4 48
Q ss_pred CCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcccc
Q 000080 2343 GINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSKCR 2386 (2389)
Q Consensus 2343 D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~~~ 2386 (2389)
|++||.||. ....++.+...|. .|++|..+.+|+-.||--|
T Consensus 321 DkkvRfwD~--Rs~~~~~sv~~gg-~vtSl~ls~~g~~lLsssR 361 (459)
T KOG0288|consen 321 DKKVRFWDI--RSADKTRSVPLGG-RVTSLDLSMDGLELLSSSR 361 (459)
T ss_pred ccceEEEec--cCCceeeEeecCc-ceeeEeeccCCeEEeeecC
Confidence 999999997 4567788888776 9999999999999888543
No 109
>KOG0643 consensus Translation initiation factor 3, subunit i (eIF-3i)/TGF-beta receptor-interacting protein (TRIP-1) [Translation, ribosomal structure and biogenesis; Signal transduction mechanisms]
Probab=99.17 E-value=1.8e-10 Score=132.67 Aligned_cols=152 Identities=16% Similarity=0.173 Sum_probs=122.7
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecc---------cCCCC---------CC---------------
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGV---------LPAAN---------VP--------------- 2266 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~v---------l~gh~---------~p--------------- 2266 (2389)
..|++++..-+.+.++|||.|.++||||+.+|+++.++.. ..+.+ |.
T Consensus 53 GavW~~Did~~s~~liTGSAD~t~kLWDv~tGk~la~~k~~~~Vk~~~F~~~gn~~l~~tD~~mg~~~~v~~fdi~~~~~ 132 (327)
T KOG0643|consen 53 GAVWCCDIDWDSKHLITGSADQTAKLWDVETGKQLATWKTNSPVKRVDFSFGGNLILASTDKQMGYTCFVSVFDIRDDSS 132 (327)
T ss_pred ceEEEEEecCCcceeeeccccceeEEEEcCCCcEEEEeecCCeeEEEeeccCCcEEEEEehhhcCcceEEEEEEccCChh
Confidence 3569999999999999999999999999999999877641 00111 00
Q ss_pred ----------CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEE
Q 000080 2267 ----------PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAA 2336 (2389)
Q Consensus 2267 ----------~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLAS 2336 (2389)
.+-+.+.++..-++|-|++|.+|..||.|..||+++|. +.+.+-+-|+..|+++.|+| |.++.+|
T Consensus 133 ~~~s~ep~~kI~t~~skit~a~Wg~l~~~ii~Ghe~G~is~~da~~g~----~~v~s~~~h~~~Ind~q~s~-d~T~FiT 207 (327)
T KOG0643|consen 133 DIDSEEPYLKIPTPDSKITSALWGPLGETIIAGHEDGSISIYDARTGK----ELVDSDEEHSSKINDLQFSR-DRTYFIT 207 (327)
T ss_pred hhcccCceEEecCCccceeeeeecccCCEEEEecCCCcEEEEEcccCc----eeeechhhhccccccccccC-CcceEEe
Confidence 12234678888899999999999999999999999873 45666678999999999999 9999999
Q ss_pred eecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhh
Q 000080 2337 AGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus 2337 AG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
+ |.|.|-+|||+. +-++++++. -+-+|++.|.+|..++.+
T Consensus 208 ~---s~Dttakl~D~~--tl~v~Kty~-te~PvN~aaisP~~d~Vi 247 (327)
T KOG0643|consen 208 G---SKDTTAKLVDVR--TLEVLKTYT-TERPVNTAAISPLLDHVI 247 (327)
T ss_pred c---ccCccceeeecc--ceeeEEEee-ecccccceecccccceEE
Confidence 6 799999999983 445567776 456899999999887653
No 110
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.17 E-value=9.3e-11 Score=142.02 Aligned_cols=136 Identities=15% Similarity=0.256 Sum_probs=117.2
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
-.|-+++.+|||++||+|+.|..|.|||..+.+.++++. ||.+.|.+++|--.-+.|-|+|.|++|++|+
T Consensus 203 keil~~avS~Dgkylatgg~d~~v~Iw~~~t~ehv~~~~----------ghr~~V~~L~fr~gt~~lys~s~Drsvkvw~ 272 (479)
T KOG0299|consen 203 KEILTLAVSSDGKYLATGGRDRHVQIWDCDTLEHVKVFK----------GHRGAVSSLAFRKGTSELYSASADRSVKVWS 272 (479)
T ss_pred ceeEEEEEcCCCcEEEecCCCceEEEecCcccchhhccc----------ccccceeeeeeecCccceeeeecCCceEEEe
Confidence 355899999999999999999999999999999998873 5789999999998889999999999999999
Q ss_pred CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
++.- ..+.++-||++.|.++.-.. -...||+| ..|+|+|||++ +....-.+.+|.+.+-|+|+=-+
T Consensus 273 ~~~~-----s~vetlyGHqd~v~~IdaL~--reR~vtVG--grDrT~rlwKi---~eesqlifrg~~~sidcv~~In~ 338 (479)
T KOG0299|consen 273 IDQL-----SYVETLYGHQDGVLGIDALS--RERCVTVG--GRDRTVRLWKI---PEESQLIFRGGEGSIDCVAFIND 338 (479)
T ss_pred hhHh-----HHHHHHhCCccceeeechhc--ccceEEec--cccceeEEEec---cccceeeeeCCCCCeeeEEEecc
Confidence 9864 35788899999999988775 46788886 69999999998 34456678899988998887433
No 111
>KOG1034 consensus Transcriptional repressor EED/ESC/FIE, required for transcriptional silencing, WD repeat superfamily [Transcription]
Probab=99.17 E-value=4.9e-11 Score=140.00 Aligned_cols=144 Identities=19% Similarity=0.239 Sum_probs=116.7
Q ss_pred EEEEEcCC----CCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEE
Q 000080 2223 RAFSSHPL----RPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCT 2297 (2389)
Q Consensus 2223 rsVAFsPd----G~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkL 2297 (2389)
..++|+-| .+++|.|+.=|.||+-|+.++++...|+ ||.+.|..|.|.|+. +++.|||.|.+|||
T Consensus 93 ytcsw~yd~~~~~p~la~~G~~GvIrVid~~~~~~~~~~~----------ghG~sINeik~~p~~~qlvls~SkD~svRl 162 (385)
T KOG1034|consen 93 YTCSWSYDSNTGNPFLAAGGYLGVIRVIDVVSGQCSKNYR----------GHGGSINEIKFHPDRPQLVLSASKDHSVRL 162 (385)
T ss_pred EEEEEEecCCCCCeeEEeecceeEEEEEecchhhhcccee----------ccCccchhhhcCCCCCcEEEEecCCceEEE
Confidence 44566554 5689999999999999999999988875 466889999999997 89999999999999
Q ss_pred eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCC----------------------CC
Q 000080 2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLA----------------------PP 2355 (2389)
Q Consensus 2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~----------------------~t 2355 (2389)
||+++.. ++-.+....||.+.|.+|.|++ +|.+|||+| .|.++++|++.. ++
T Consensus 163 wnI~~~~--Cv~VfGG~egHrdeVLSvD~~~-~gd~i~ScG---mDhslk~W~l~~~~f~~~lE~s~~~~~~~t~~pfpt 236 (385)
T KOG1034|consen 163 WNIQTDV--CVAVFGGVEGHRDEVLSVDFSL-DGDRIASCG---MDHSLKLWRLNVKEFKNKLELSITYSPNKTTRPFPT 236 (385)
T ss_pred EeccCCe--EEEEecccccccCcEEEEEEcC-CCCeeeccC---CcceEEEEecChhHHhhhhhhhcccCCCCccCcCCc
Confidence 9999873 4455677899999999999999 999999976 899999999831 11
Q ss_pred CCc-e---EEEEeecCcEEEEeecccchhhhcc
Q 000080 2356 TSS-R---ASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2356 g~~-v---~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
.++ + .+-.-|++-|.|+-.. |||+|||
T Consensus 237 ~~~~fp~fst~diHrnyVDCvrw~--gd~ilSk 267 (385)
T KOG1034|consen 237 PKTHFPDFSTTDIHRNYVDCVRWF--GDFILSK 267 (385)
T ss_pred cccccccccccccccchHHHHHHH--hhheeec
Confidence 111 1 1334588888887764 6999998
No 112
>KOG0283 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.16 E-value=1.7e-10 Score=147.15 Aligned_cols=108 Identities=19% Similarity=0.274 Sum_probs=91.8
Q ss_pred EEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-CCEEEEEeCCCcEEEeeC
Q 000080 2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-GHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~DgTVkLWDl 2300 (2389)
|-.|+||-++ +|+|+|-|.|||||+++..+|+.+|. |.+.|+||+|+|- .++|+|||.||.||||++
T Consensus 372 ILDlSWSKn~-fLLSSSMDKTVRLWh~~~~~CL~~F~-----------HndfVTcVaFnPvDDryFiSGSLD~KvRiWsI 439 (712)
T KOG0283|consen 372 ILDLSWSKNN-FLLSSSMDKTVRLWHPGRKECLKVFS-----------HNDFVTCVAFNPVDDRYFISGSLDGKVRLWSI 439 (712)
T ss_pred heecccccCC-eeEeccccccEEeecCCCcceeeEEe-----------cCCeeEEEEecccCCCcEeecccccceEEeec
Confidence 3778999865 88899999999999999999999995 6799999999996 589999999999999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
-.. +...-..+| .-|++|+|.| ||+..+.| +-+|.++++++
T Consensus 440 ~d~-----~Vv~W~Dl~-~lITAvcy~P-dGk~avIG---t~~G~C~fY~t 480 (712)
T KOG0283|consen 440 SDK-----KVVDWNDLR-DLITAVCYSP-DGKGAVIG---TFNGYCRFYDT 480 (712)
T ss_pred CcC-----eeEeehhhh-hhheeEEecc-CCceEEEE---EeccEEEEEEc
Confidence 753 222222333 7899999999 89988875 68999999998
No 113
>KOG1539 consensus WD repeat protein [General function prediction only]
Probab=99.15 E-value=1.7e-10 Score=146.47 Aligned_cols=176 Identities=13% Similarity=0.179 Sum_probs=143.3
Q ss_pred ccccccccccccceeeccccccccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCC
Q 000080 2183 GLAFGIPGYAGIGASALGWETQDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPA 2262 (2389)
Q Consensus 2183 ~~~~~~~g~~~~~Asg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~g 2262 (2389)
-|-|++-||..=-...||-.--.-...|-+.+++- -+|+.|+..-.++.++|++.||.++.||+.++..+.+++. +
T Consensus 459 CGNF~~IG~S~G~Id~fNmQSGi~r~sf~~~~ah~--~~V~gla~D~~n~~~vsa~~~Gilkfw~f~~k~l~~~l~l--~ 534 (910)
T KOG1539|consen 459 CGNFVFIGYSKGTIDRFNMQSGIHRKSFGDSPAHK--GEVTGLAVDGTNRLLVSAGADGILKFWDFKKKVLKKSLRL--G 534 (910)
T ss_pred cCceEEEeccCCeEEEEEcccCeeecccccCcccc--CceeEEEecCCCceEEEccCcceEEEEecCCcceeeeecc--C
Confidence 34677777776666665555555555554444443 3459999999999999999999999999988888888763 2
Q ss_pred CCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCC
Q 000080 2263 ANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSN 2342 (2389)
Q Consensus 2263 h~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~ 2342 (2389)
..+..+..+.....||.+.+|=.|++.|+.|. +..+.+.||++.|++.+||| ||++|++| +.
T Consensus 535 ---------~~~~~iv~hr~s~l~a~~~ddf~I~vvD~~t~-----kvvR~f~gh~nritd~~FS~-DgrWlisa---sm 596 (910)
T KOG1539|consen 535 ---------SSITGIVYHRVSDLLAIALDDFSIRVVDVVTR-----KVVREFWGHGNRITDMTFSP-DGRWLISA---SM 596 (910)
T ss_pred ---------CCcceeeeeehhhhhhhhcCceeEEEEEchhh-----hhhHHhhccccceeeeEeCC-CCcEEEEe---ec
Confidence 45788888888899999999999999999984 57788999999999999999 99999998 69
Q ss_pred CCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080 2343 GINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2343 D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
|++||+||+ ++++++-.+- -+....++.++|-|+|...
T Consensus 597 D~tIr~wDl--pt~~lID~~~-vd~~~~sls~SPngD~LAT 634 (910)
T KOG1539|consen 597 DSTIRTWDL--PTGTLIDGLL-VDSPCTSLSFSPNGDFLAT 634 (910)
T ss_pred CCcEEEEec--cCcceeeeEe-cCCcceeeEECCCCCEEEE
Confidence 999999998 7888776664 5678899999999998643
No 114
>KOG0300 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.14 E-value=2.9e-10 Score=132.40 Aligned_cols=156 Identities=21% Similarity=0.301 Sum_probs=116.3
Q ss_pred cccccccccccc--cCCCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEE
Q 000080 2200 GWETQDDFEDYV--DPPATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASIS 2275 (2389)
Q Consensus 2200 ~~d~~~~~~~~~--d~~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~ 2275 (2389)
+||-+.-+|+.. .++..+.+ -...-++-||+.++++++|.|.|.||||++ ..++...++ .||.+.|+
T Consensus 291 SWDRTAnlwDVEtge~v~~LtGHd~ELtHcstHptQrLVvTsSrDtTFRLWDFR--eaI~sV~VF-------QGHtdtVT 361 (481)
T KOG0300|consen 291 SWDRTANLWDVETGEVVNILTGHDSELTHCSTHPTQRLVVTSSRDTTFRLWDFR--EAIQSVAVF-------QGHTDTVT 361 (481)
T ss_pred eccccceeeeeccCceeccccCcchhccccccCCcceEEEEeccCceeEeccch--hhcceeeee-------ccccccee
Confidence 677777777653 11111111 123445889999999999999999999997 444443333 26789999
Q ss_pred EEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCC
Q 000080 2276 ALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPP 2355 (2389)
Q Consensus 2276 sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~t 2355 (2389)
++.|+-|. .++|||+|.|||+||++.. | .|+.+.. -...++.|+.+. .+.+||-- -+++.|||+|+ +
T Consensus 362 S~vF~~dd-~vVSgSDDrTvKvWdLrNM-R---splATIR-tdS~~NRvavs~-g~~iIAiP---hDNRqvRlfDl---n 428 (481)
T KOG0300|consen 362 SVVFNTDD-RVVSGSDDRTVKVWDLRNM-R---SPLATIR-TDSPANRVAVSK-GHPIIAIP---HDNRQVRLFDL---N 428 (481)
T ss_pred EEEEecCC-ceeecCCCceEEEeeeccc-c---Ccceeee-cCCccceeEeec-CCceEEec---cCCceEEEEec---C
Confidence 99999875 6899999999999999986 3 4666665 456789999998 66788874 47899999998 3
Q ss_pred CCceE-----EEEeecCcEEEEeeccc
Q 000080 2356 TSSRA-----SITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus 2356 g~~v~-----sL~GH~~~V~svA~~~~ 2377 (2389)
|..+. +-+||.--|+|.|-.+.
T Consensus 429 G~RlaRlPrtsRqgHrRMV~c~AW~ee 455 (481)
T KOG0300|consen 429 GNRLARLPRTSRQGHRRMVTCCAWLEE 455 (481)
T ss_pred CCccccCCcccccccceeeeeeecccc
Confidence 54443 45799999999997764
No 115
>KOG0639 consensus Transducin-like enhancer of split protein (contains WD40 repeats) [Chromatin structure and dynamics]
Probab=99.12 E-value=7e-11 Score=143.14 Aligned_cols=143 Identities=13% Similarity=0.147 Sum_probs=116.1
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
.+||++-.+|||+.|++|+.-.|+.|||+.........+ ++.. ....++++.|||.+...++..||.|.+||
T Consensus 466 nyiRSckL~pdgrtLivGGeastlsiWDLAapTprikae-ltss-------apaCyALa~spDakvcFsccsdGnI~vwD 537 (705)
T KOG0639|consen 466 NYIRSCKLLPDGRTLIVGGEASTLSIWDLAAPTPRIKAE-LTSS-------APACYALAISPDAKVCFSCCSDGNIAVWD 537 (705)
T ss_pred cceeeeEecCCCceEEeccccceeeeeeccCCCcchhhh-cCCc-------chhhhhhhcCCccceeeeeccCCcEEEEE
Confidence 478999999999999999999999999998776433222 1111 13478899999999999999999999999
Q ss_pred CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccch
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~ 2379 (2389)
+... ..+++++||++.+.+|..++ ||..|=||| -|+|||-||.. ++..++.-+ ...+|-++...|.|+
T Consensus 538 Lhnq-----~~VrqfqGhtDGascIdis~-dGtklWTGG---lDntvRcWDlr--egrqlqqhd-F~SQIfSLg~cP~~d 605 (705)
T KOG0639|consen 538 LHNQ-----TLVRQFQGHTDGASCIDISK-DGTKLWTGG---LDNTVRCWDLR--EGRQLQQHD-FSSQIFSLGYCPTGD 605 (705)
T ss_pred cccc-----eeeecccCCCCCceeEEecC-CCceeecCC---Cccceeehhhh--hhhhhhhhh-hhhhheecccCCCcc
Confidence 9864 46899999999999999999 999999976 89999999983 333333222 346788999999999
Q ss_pred hhh
Q 000080 2380 FAL 2382 (2389)
Q Consensus 2380 ~~~ 2382 (2389)
|.+
T Consensus 606 Wla 608 (705)
T KOG0639|consen 606 WLA 608 (705)
T ss_pred cee
Confidence 964
No 116
>PF08662 eIF2A: Eukaryotic translation initiation factor eIF2A; InterPro: IPR013979 This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins.
Probab=99.12 E-value=7.6e-10 Score=124.65 Aligned_cols=116 Identities=17% Similarity=0.280 Sum_probs=90.9
Q ss_pred eEEEEEEcCCCCeEE--EEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC---CcE
Q 000080 2221 STRAFSSHPLRPFFL--VGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD---GTV 2295 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LA--SGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D---gTV 2295 (2389)
+|.+++|+|+|..+| +|..++.|.|||+. ++.+.++. ...+..|.|||+|++||.|+.+ |.|
T Consensus 61 ~I~~~~WsP~g~~favi~g~~~~~v~lyd~~-~~~i~~~~------------~~~~n~i~wsP~G~~l~~~g~~n~~G~l 127 (194)
T PF08662_consen 61 PIHDVAWSPNGNEFAVIYGSMPAKVTLYDVK-GKKIFSFG------------TQPRNTISWSPDGRFLVLAGFGNLNGDL 127 (194)
T ss_pred ceEEEEECcCCCEEEEEEccCCcccEEEcCc-ccEeEeec------------CCCceEEEECCCCCEEEEEEccCCCcEE
Confidence 579999999999754 46678899999995 77777762 2457899999999999999855 669
Q ss_pred EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCC----CCCeEEEeeCCCCCCCceEE
Q 000080 2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSS----NGINVVVWDTLAPPTSSRAS 2361 (2389)
Q Consensus 2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS----~D~TVrLWD~l~~tg~~v~s 2361 (2389)
.+||+++. +.+.+.. |. .+..++|+| ||++|||+. ++ .|+.++||+. +|+.+..
T Consensus 128 ~~wd~~~~-----~~i~~~~-~~-~~t~~~WsP-dGr~~~ta~-t~~r~~~dng~~Iw~~---~G~~l~~ 185 (194)
T PF08662_consen 128 EFWDVRKK-----KKISTFE-HS-DATDVEWSP-DGRYLATAT-TSPRLRVDNGFKIWSF---QGRLLYK 185 (194)
T ss_pred EEEECCCC-----EEeeccc-cC-cEEEEEEcC-CCCEEEEEE-eccceeccccEEEEEe---cCeEeEe
Confidence 99999964 3444442 43 478999999 999999985 22 5899999997 5666544
No 117
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=99.12 E-value=1.3e-09 Score=123.57 Aligned_cols=139 Identities=9% Similarity=0.002 Sum_probs=100.1
Q ss_pred EEEEEcCCCCeEE-EEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEE-EEeCCCcEEEeeC
Q 000080 2223 RAFSSHPLRPFFL-VGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFA-SAALDGTVCTWQL 2300 (2389)
Q Consensus 2223 rsVAFsPdG~~LA-SGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LA-SgS~DgTVkLWDl 2300 (2389)
+.++|+|+|++|+ ++..|++|++||+.+++++.++.. .....+ ++ ......++|+|||+.+. +.+.+++|.+||+
T Consensus 160 ~~~~~s~dg~~l~~~~~~~~~v~i~d~~~~~~~~~~~~-~~~~~~-~~-~~~~~~i~~s~dg~~~~~~~~~~~~i~v~d~ 236 (300)
T TIGR03866 160 RFAEFTADGKELWVSSEIGGTVSVIDVATRKVIKKITF-EIPGVH-PE-AVQPVGIKLTKDGKTAFVALGPANRVAVVDA 236 (300)
T ss_pred cEEEECCCCCEEEEEcCCCCEEEEEEcCcceeeeeeee-cccccc-cc-cCCccceEECCCCCEEEEEcCCCCeEEEEEC
Confidence 6689999999875 555699999999999988776531 111100 01 12345789999999854 4456788999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
+++. ..... .+...+.+++|+| +|+.|++++ ..+++|++||+ .+++++++++.+ ++.+.+|++|
T Consensus 237 ~~~~-----~~~~~-~~~~~~~~~~~~~-~g~~l~~~~--~~~~~i~v~d~--~~~~~~~~~~~~-~~~~~~~~~~ 300 (300)
T TIGR03866 237 KTYE-----VLDYL-LVGQRVWQLAFTP-DEKYLLTTN--GVSNDVSVIDV--AALKVIKSIKVG-RLPWGVVVRP 300 (300)
T ss_pred CCCc-----EEEEE-EeCCCcceEEECC-CCCEEEEEc--CCCCeEEEEEC--CCCcEEEEEEcc-cccceeEeCC
Confidence 8762 23332 2445788999999 999998753 47899999998 467778888754 5668888764
No 118
>KOG0269 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.11 E-value=8.2e-11 Score=148.40 Aligned_cols=144 Identities=19% Similarity=0.253 Sum_probs=120.7
Q ss_pred EEEEEEcC-CCCeEEEEeCCCcEEEeecCC---CceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEE
Q 000080 2222 TRAFSSHP-LRPFFLVGSSNTHIYLWEFGK---DKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVC 2296 (2389)
Q Consensus 2222 VrsVAFsP-dG~~LASGS~DgTIRLWDl~t---Gk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVk 2296 (2389)
.-.|.|+. +.++|||++..|.|-+||+.. .+++..|. -|...|+++.|++-- +.|.|||.||+||
T Consensus 90 ~~DVkW~~~~~NlIAT~s~nG~i~vWdlnk~~rnk~l~~f~----------EH~Rs~~~ldfh~tep~iliSGSQDg~vK 159 (839)
T KOG0269|consen 90 AADVKWGQLYSNLIATCSTNGVISVWDLNKSIRNKLLTVFN----------EHERSANKLDFHSTEPNILISGSQDGTVK 159 (839)
T ss_pred hhhcccccchhhhheeecCCCcEEEEecCccccchhhhHhh----------hhccceeeeeeccCCccEEEecCCCceEE
Confidence 34456774 366899999999999999986 44555553 367899999999874 8999999999999
Q ss_pred EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080 2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus 2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
+||++.. +-..+..+-+-.|++|.|+|..+...|++ .+.|++++||+. ++.+|...|..|.+.|.|+..+|
T Consensus 160 ~~DlR~~-----~S~~t~~~nSESiRDV~fsp~~~~~F~s~---~dsG~lqlWDlR-qp~r~~~k~~AH~GpV~c~nwhP 230 (839)
T KOG0269|consen 160 CWDLRSK-----KSKSTFRSNSESIRDVKFSPGYGNKFASI---HDSGYLQLWDLR-QPDRCEKKLTAHNGPVLCLNWHP 230 (839)
T ss_pred EEeeecc-----cccccccccchhhhceeeccCCCceEEEe---cCCceEEEeecc-CchhHHHHhhcccCceEEEeecC
Confidence 9999975 23455666788999999999999999986 589999999996 57888999999999999999999
Q ss_pred cchhhhcc
Q 000080 2377 LLNFALSK 2384 (2389)
Q Consensus 2377 ~~~~~~s~ 2384 (2389)
.+.|+-+-
T Consensus 231 nr~~lATG 238 (839)
T KOG0269|consen 231 NREWLATG 238 (839)
T ss_pred CCceeeec
Confidence 99987654
No 119
>KOG0643 consensus Translation initiation factor 3, subunit i (eIF-3i)/TGF-beta receptor-interacting protein (TRIP-1) [Translation, ribosomal structure and biogenesis; Signal transduction mechanisms]
Probab=99.11 E-value=5.5e-10 Score=128.80 Aligned_cols=148 Identities=11% Similarity=0.137 Sum_probs=129.0
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
.-|.++.+|.+|.|++-|.++.+|=--+|+.+-||. ||++.|+++..+-+.+.+.+||.|.|++|||+++
T Consensus 14 TqiKyN~eGDLlFscaKD~~~~vw~s~nGerlGty~----------GHtGavW~~Did~~s~~liTGSAD~t~kLWDv~t 83 (327)
T KOG0643|consen 14 TQIKYNREGDLLFSCAKDSTPTVWYSLNGERLGTYD----------GHTGAVWCCDIDWDSKHLITGSADQTAKLWDVET 83 (327)
T ss_pred ceEEecCCCcEEEEecCCCCceEEEecCCceeeeec----------CCCceEEEEEecCCcceeeeccccceeEEEEcCC
Confidence 556999999999999999999999988999999995 6789999999999999999999999999999999
Q ss_pred CCc------------------------------------------------cCcccceeeeecCCCeeEEEEecCCCCEE
Q 000080 2303 GGR------------------------------------------------SNVRPMESCLCFSSHAMDVSYITSSGSVI 2334 (2389)
Q Consensus 2303 ggr------------------------------------------------s~~k~l~tl~gHs~~V~sVAFSP~DGslL 2334 (2389)
|.. ....|+..+..+...+..+-|.| -|+.|
T Consensus 84 Gk~la~~k~~~~Vk~~~F~~~gn~~l~~tD~~mg~~~~v~~fdi~~~~~~~~s~ep~~kI~t~~skit~a~Wg~-l~~~i 162 (327)
T KOG0643|consen 84 GKQLATWKTNSPVKRVDFSFGGNLILASTDKQMGYTCFVSVFDIRDDSSDIDSEEPYLKIPTPDSKITSALWGP-LGETI 162 (327)
T ss_pred CcEEEEeecCCeeEEEeeccCCcEEEEEehhhcCcceEEEEEEccCChhhhcccCceEEecCCccceeeeeecc-cCCEE
Confidence 832 02345777788889999999999 89999
Q ss_pred EEeecCCCCCeEEEeeCCCCCCCc-eEEEEeecCcEEEEeecccchhhhcccc
Q 000080 2335 AAAGHSSNGINVVVWDTLAPPTSS-RASITCHEGLYDLFLPLKLLNFALSKCR 2386 (2389)
Q Consensus 2335 ASAG~sS~D~TVrLWD~l~~tg~~-v~sL~GH~~~V~svA~~~~~~~~~s~~~ 2386 (2389)
.++ -+|+.|.+||. .+++. +.+-+-|...|+.+-+++++-+-+..|+
T Consensus 163 i~G---he~G~is~~da--~~g~~~v~s~~~h~~~Ind~q~s~d~T~FiT~s~ 210 (327)
T KOG0643|consen 163 IAG---HEDGSISIYDA--RTGKELVDSDEEHSSKINDLQFSRDRTYFITGSK 210 (327)
T ss_pred EEe---cCCCcEEEEEc--ccCceeeechhhhccccccccccCCcceEEeccc
Confidence 986 48999999998 45544 7888999999999999999988776654
No 120
>KOG0641 consensus WD40 repeat protein [General function prediction only]
Probab=99.11 E-value=9.7e-10 Score=123.91 Aligned_cols=144 Identities=16% Similarity=0.215 Sum_probs=109.8
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC---C-------CCCCCCCEEEEEECCCCCEEEEE
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV---P-------PPYALASISALQFDHYGHRFASA 2289 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~---p-------~~GH~~~V~sVaFSPDG~~LASg 2289 (2389)
-.||+|+|||.|.+.|.||...|.|+-....=. .++ .+|.. | .-.|.+.|+++++||+|..||+|
T Consensus 33 qairav~fhp~g~lyavgsnskt~ric~yp~l~---~~r--~~hea~~~pp~v~~kr~khhkgsiyc~~ws~~geliatg 107 (350)
T KOG0641|consen 33 QAIRAVAFHPAGGLYAVGSNSKTFRICAYPALI---DLR--HAHEAAKQPPSVLCKRNKHHKGSIYCTAWSPCGELIATG 107 (350)
T ss_pred hheeeEEecCCCceEEeccCCceEEEEcccccc---Ccc--cccccccCCCeEEeeeccccCccEEEEEecCccCeEEec
Confidence 457999999999999999999999998753111 111 11211 1 12477899999999999999999
Q ss_pred eCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecC---CCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeec
Q 000080 2290 ALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITS---SGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHE 2366 (2389)
Q Consensus 2290 S~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~---DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~ 2366 (2389)
|.|.+||+--.+.......-+-..+.-|.+.|++++|.-+ .|.+||||| ..|..|.+=|. ..|+..+.+.||+
T Consensus 108 sndk~ik~l~fn~dt~~~~g~dle~nmhdgtirdl~fld~~~s~~~il~s~g--agdc~iy~tdc--~~g~~~~a~sght 183 (350)
T KOG0641|consen 108 SNDKTIKVLPFNADTCNATGHDLEFNMHDGTIRDLAFLDDPESGGAILASAG--AGDCKIYITDC--GRGQGFHALSGHT 183 (350)
T ss_pred CCCceEEEEecccccccccCcceeeeecCCceeeeEEecCCCcCceEEEecC--CCcceEEEeec--CCCCcceeecCCc
Confidence 9999999987765322112233556679999999999843 567899987 67888888887 6788899999999
Q ss_pred CcEEEE
Q 000080 2367 GLYDLF 2372 (2389)
Q Consensus 2367 ~~V~sv 2372 (2389)
+-|-++
T Consensus 184 ghilal 189 (350)
T KOG0641|consen 184 GHILAL 189 (350)
T ss_pred ccEEEE
Confidence 988654
No 121
>COG2319 FOG: WD40 repeat [General function prediction only]
Probab=99.11 E-value=1.8e-09 Score=121.14 Aligned_cols=142 Identities=23% Similarity=0.310 Sum_probs=114.3
Q ss_pred eEEEEEEcCCCCeEEEEeC-CCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCC-EEEEEeCCCcEEEe
Q 000080 2221 STRAFSSHPLRPFFLVGSS-NTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGH-RFASAALDGTVCTW 2298 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~-DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~-~LASgS~DgTVkLW 2298 (2389)
.|+.++|+|+++.+++++. |+++++|+..+++.+.++. +|...|.+++|+|+|. .+++++.|++|++|
T Consensus 157 ~v~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~----------~~~~~v~~~~~~~~~~~~~~~~~~d~~i~~w 226 (466)
T COG2319 157 SVTSLAFSPDGKLLASGSSLDGTIKLWDLRTGKPLSTLA----------GHTDPVSSLAFSPDGGLLIASGSSDGTIRLW 226 (466)
T ss_pred cEEEEEECCCCCEEEecCCCCCceEEEEcCCCceEEeec----------cCCCceEEEEEcCCcceEEEEecCCCcEEEE
Confidence 3478999999999999986 9999999998888877763 3678999999999998 66777999999999
Q ss_pred eCCCCCccCcccce-eeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080 2299 QLEVGGRSNVRPME-SCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~-tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
|...+ .... .+.+|...+ -..|+| +|..++++ +.|+++++||+.. ....+..+.+|...|.++++.|+
T Consensus 227 d~~~~-----~~~~~~~~~~~~~~-~~~~~~-~~~~~~~~---~~d~~~~~~~~~~-~~~~~~~~~~~~~~v~~~~~~~~ 295 (466)
T COG2319 227 DLSTG-----KLLRSTLSGHSDSV-VSSFSP-DGSLLASG---SSDGTIRLWDLRS-SSSLLRTLSGHSSSVLSVAFSPD 295 (466)
T ss_pred ECCCC-----cEEeeecCCCCcce-eEeECC-CCCEEEEe---cCCCcEEEeeecC-CCcEEEEEecCCccEEEEEECCC
Confidence 98864 2344 588888875 448999 77888865 6999999999842 22235555889999999999997
Q ss_pred chhhhc
Q 000080 2378 LNFALS 2383 (2389)
Q Consensus 2378 ~~~~~s 2383 (2389)
++...+
T Consensus 296 ~~~~~~ 301 (466)
T COG2319 296 GKLLAS 301 (466)
T ss_pred CCEEEE
Confidence 666554
No 122
>KOG1034 consensus Transcriptional repressor EED/ESC/FIE, required for transcriptional silencing, WD repeat superfamily [Transcription]
Probab=99.09 E-value=4.6e-10 Score=132.04 Aligned_cols=158 Identities=19% Similarity=0.235 Sum_probs=113.2
Q ss_pred eEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2221 STRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2221 ~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
+|..|.|||+.+ +++|||.|.+|||||++++.|+..|.+++| |.+.|-+|.|++||.+|||++.|.++++|+
T Consensus 137 sINeik~~p~~~qlvls~SkD~svRlwnI~~~~Cv~VfGG~eg-------HrdeVLSvD~~~~gd~i~ScGmDhslk~W~ 209 (385)
T KOG1034|consen 137 SINEIKFHPDRPQLVLSASKDHSVRLWNIQTDVCVAVFGGVEG-------HRDEVLSVDFSLDGDRIASCGMDHSLKLWR 209 (385)
T ss_pred cchhhhcCCCCCcEEEEecCCceEEEEeccCCeEEEEeccccc-------ccCcEEEEEEcCCCCeeeccCCcceEEEEe
Confidence 568889999864 899999999999999999999999976554 568899999999999999999999999999
Q ss_pred CCCCC------cc----------------Ccccce-eeeecC--------------------------------------
Q 000080 2300 LEVGG------RS----------------NVRPME-SCLCFS-------------------------------------- 2318 (2389)
Q Consensus 2300 l~tgg------rs----------------~~k~l~-tl~gHs-------------------------------------- 2318 (2389)
+++.. ++ .+-|.+ +-.-|.
T Consensus 210 l~~~~f~~~lE~s~~~~~~~t~~pfpt~~~~fp~fst~diHrnyVDCvrw~gd~ilSkscenaI~~w~pgkl~e~~~~vk 289 (385)
T KOG1034|consen 210 LNVKEFKNKLELSITYSPNKTTRPFPTPKTHFPDFSTTDIHRNYVDCVRWFGDFILSKSCENAIVCWKPGKLEESIHNVK 289 (385)
T ss_pred cChhHHhhhhhhhcccCCCCccCcCCccccccccccccccccchHHHHHHHhhheeecccCceEEEEecchhhhhhhccC
Confidence 98320 00 000000 001111
Q ss_pred ----------------CCeeE--EEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeec--CcEEEEeecccc
Q 000080 2319 ----------------SHAMD--VSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHE--GLYDLFLPLKLL 2378 (2389)
Q Consensus 2319 ----------------~~V~s--VAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~--~~V~svA~~~~~ 2378 (2389)
..++- .+|.| =+++||.+ ...+.|.+||+.........+|..+. ..|+..+++++|
T Consensus 290 p~es~~Ti~~~~~~~~c~iWfirf~~d~-~~~~la~g---nq~g~v~vwdL~~~ep~~~ttl~~s~~~~tVRQ~sfS~dg 365 (385)
T KOG1034|consen 290 PPESATTILGEFDYPMCDIWFIRFAFDP-WQKMLALG---NQSGKVYVWDLDNNEPPKCTTLTHSKSGSTVRQTSFSRDG 365 (385)
T ss_pred CCccceeeeeEeccCccceEEEEEeecH-HHHHHhhc---cCCCcEEEEECCCCCCccCceEEeccccceeeeeeecccC
Confidence 12222 34445 45778875 47899999998421111234555443 347799999999
Q ss_pred hhhhccccccC
Q 000080 2379 NFALSKCRCLF 2389 (2389)
Q Consensus 2379 ~~~~s~~~~~~ 2389 (2389)
...|--|.|.+
T Consensus 366 s~lv~vcdd~~ 376 (385)
T KOG1034|consen 366 SILVLVCDDGT 376 (385)
T ss_pred cEEEEEeCCCc
Confidence 99999998864
No 123
>KOG0288 consensus WD40 repeat protein TipD [General function prediction only]
Probab=99.08 E-value=9.6e-10 Score=132.09 Aligned_cols=166 Identities=16% Similarity=0.166 Sum_probs=121.1
Q ss_pred eeccccccccccccccCCCC--cC-ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCC
Q 000080 2197 SALGWETQDDFEDYVDPPAT--VE-NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALAS 2273 (2389)
Q Consensus 2197 sg~~~d~~~~~~~~~d~~at--v~-ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~ 2273 (2389)
+| ++|-+.+.|+......+ +- .-.+..|..+ +..++||-.|++||+||.+++.++.+. |++ +.
T Consensus 278 sg-s~DRtiK~WDl~k~~C~kt~l~~S~cnDI~~~--~~~~~SgH~DkkvRfwD~Rs~~~~~sv---~~g--------g~ 343 (459)
T KOG0288|consen 278 SG-SADRTIKLWDLQKAYCSKTVLPGSQCNDIVCS--ISDVISGHFDKKVRFWDIRSADKTRSV---PLG--------GR 343 (459)
T ss_pred ec-cccchhhhhhhhhhheeccccccccccceEec--ceeeeecccccceEEEeccCCceeeEe---ecC--------cc
Confidence 44 66667777766422111 10 0012444555 667999999999999999999887765 222 58
Q ss_pred EEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeec--CCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2274 ISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCF--SSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2274 V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gH--s~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
|++|..+++|..+.|.+.|.|+++-|+++.+ ++..++-.|. ....+.+.||| ||.++|+| |.||.|.||++
T Consensus 344 vtSl~ls~~g~~lLsssRDdtl~viDlRt~e---I~~~~sA~g~k~asDwtrvvfSp-d~~YvaAG---S~dgsv~iW~v 416 (459)
T KOG0288|consen 344 VTSLDLSMDGLELLSSSRDDTLKVIDLRTKE---IRQTFSAEGFKCASDWTRVVFSP-DGSYVAAG---SADGSVYIWSV 416 (459)
T ss_pred eeeEeeccCCeEEeeecCCCceeeeeccccc---EEEEeeccccccccccceeEECC-CCceeeec---cCCCcEEEEEc
Confidence 9999999999999999999999999999852 2222222221 12366799999 99999985 68999999999
Q ss_pred CCCCCCceEEEEee-cC-cEEEEeecccchhhhccc
Q 000080 2352 LAPPTSSRASITCH-EG-LYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus 2352 l~~tg~~v~sL~GH-~~-~V~svA~~~~~~~~~s~~ 2385 (2389)
. ++++...+... .+ +|.+++..|.|.-.||--
T Consensus 417 ~--tgKlE~~l~~s~s~~aI~s~~W~~sG~~Llsad 450 (459)
T KOG0288|consen 417 F--TGKLEKVLSLSTSNAAITSLSWNPSGSGLLSAD 450 (459)
T ss_pred c--CceEEEEeccCCCCcceEEEEEcCCCchhhccc
Confidence 4 78887666543 33 699999999999998853
No 124
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=99.08 E-value=1.3e-09 Score=123.48 Aligned_cols=130 Identities=12% Similarity=0.065 Sum_probs=98.8
Q ss_pred CCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEE-EEEeCCCcEEEeeCCCCCccCcc
Q 000080 2231 RPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRF-ASAALDGTVCTWQLEVGGRSNVR 2309 (2389)
Q Consensus 2231 G~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~L-ASgS~DgTVkLWDl~tggrs~~k 2309 (2389)
+..++|++.|++|++||..+++.+.++. ++ ..+++++|+|||+.+ ++++.|++|++||+.++.
T Consensus 1 ~~~~~s~~~d~~v~~~d~~t~~~~~~~~---~~--------~~~~~l~~~~dg~~l~~~~~~~~~v~~~d~~~~~----- 64 (300)
T TIGR03866 1 EKAYVSNEKDNTISVIDTATLEVTRTFP---VG--------QRPRGITLSKDGKLLYVCASDSDTIQVIDLATGE----- 64 (300)
T ss_pred CcEEEEecCCCEEEEEECCCCceEEEEE---CC--------CCCCceEECCCCCEEEEEECCCCeEEEEECCCCc-----
Confidence 3578999999999999999999888774 11 336789999999876 678889999999999862
Q ss_pred cceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080 2310 PMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2310 ~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
....+..+.. +..++|+| +|+.++.++ +.|++|++||+ .+.+.+..+.. ...+.+++++|+|++++.
T Consensus 65 ~~~~~~~~~~-~~~~~~~~-~g~~l~~~~--~~~~~l~~~d~--~~~~~~~~~~~-~~~~~~~~~~~dg~~l~~ 131 (300)
T TIGR03866 65 VIGTLPSGPD-PELFALHP-NGKILYIAN--EDDNLVTVIDI--ETRKVLAEIPV-GVEPEGMAVSPDGKIVVN 131 (300)
T ss_pred EEEeccCCCC-ccEEEECC-CCCEEEEEc--CCCCeEEEEEC--CCCeEEeEeeC-CCCcceEEECCCCCEEEE
Confidence 3344444433 56799999 888776543 57899999998 34556666663 334678999999987653
No 125
>KOG1274 consensus WD40 repeat protein [General function prediction only]
Probab=99.08 E-value=1.1e-09 Score=140.60 Aligned_cols=171 Identities=17% Similarity=0.128 Sum_probs=121.4
Q ss_pred cccccceeeccccccccccccccC--CCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC
Q 000080 2190 GYAGIGASALGWETQDDFEDYVDP--PATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV 2265 (2389)
Q Consensus 2190 g~~~~~Asg~~~d~~~~~~~~~d~--~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~ 2265 (2389)
|.+.+.|-| +.|+..++-..-|. +.++.. .+|..|+|+|++.+||+.+-||+|++||+.++.+..++..++..+
T Consensus 106 g~g~~iaag-sdD~~vK~~~~~D~s~~~~lrgh~apVl~l~~~p~~~fLAvss~dG~v~iw~~~~~~~~~tl~~v~k~n- 183 (933)
T KOG1274|consen 106 GSGKMIAAG-SDDTAVKLLNLDDSSQEKVLRGHDAPVLQLSYDPKGNFLAVSSCDGKVQIWDLQDGILSKTLTGVDKDN- 183 (933)
T ss_pred cCCcEEEee-cCceeEEEEeccccchheeecccCCceeeeeEcCCCCEEEEEecCceEEEEEcccchhhhhcccCCccc-
Confidence 444455556 55655555544322 222333 367999999999999999999999999999999988876433222
Q ss_pred CCCCC--CCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeee--cCCCeeEEEEecCCCCEEEEeecCC
Q 000080 2266 PPPYA--LASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLC--FSSHAMDVSYITSSGSVIAAAGHSS 2341 (2389)
Q Consensus 2266 p~~GH--~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~g--Hs~~V~sVAFSP~DGslLASAG~sS 2341 (2389)
+. ..-+..++|+|+|..||..+.|++|++++.+... +.+.+.. |+..+.+++|+| .|++||++ +
T Consensus 184 ---~~~~s~i~~~~aW~Pk~g~la~~~~d~~Vkvy~r~~we-----~~f~Lr~~~~ss~~~~~~wsP-nG~YiAAs---~ 251 (933)
T KOG1274|consen 184 ---EFILSRICTRLAWHPKGGTLAVPPVDNTVKVYSRKGWE-----LQFKLRDKLSSSKFSDLQWSP-NGKYIAAS---T 251 (933)
T ss_pred ---cccccceeeeeeecCCCCeEEeeccCCeEEEEccCCce-----eheeecccccccceEEEEEcC-CCcEEeee---c
Confidence 11 2346779999999999999999999999998763 2222222 444488999999 89999986 5
Q ss_pred CCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080 2342 NGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus 2342 ~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
.||.|-|||+- +.. + .--...|.|+|+.|.+|.
T Consensus 252 ~~g~I~vWnv~--t~~-~---~~~~~~Vc~~aw~p~~n~ 284 (933)
T KOG1274|consen 252 LDGQILVWNVD--THE-R---HEFKRAVCCEAWKPNANA 284 (933)
T ss_pred cCCcEEEEecc--cch-h---ccccceeEEEecCCCCCe
Confidence 89999999982 211 1 112245778888887764
No 126
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=99.07 E-value=5.9e-11 Score=135.39 Aligned_cols=139 Identities=8% Similarity=0.090 Sum_probs=121.3
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.|++.+.+.|...-|||+.|-|.|+||.-+|..+.+|+ |..-|.+|+|+.|.+.|.+|+.+.-+|++|+
T Consensus 61 avw~~~l~~na~~aasaaadftakvw~a~tgdelhsf~-----------hkhivk~~af~~ds~~lltgg~ekllrvfdl 129 (334)
T KOG0278|consen 61 AVWSATLNKNATRAASAAADFTAKVWDAVTGDELHSFE-----------HKHIVKAVAFSQDSNYLLTGGQEKLLRVFDL 129 (334)
T ss_pred ceeeeecCchhhhhhhhcccchhhhhhhhhhhhhhhhh-----------hhheeeeEEecccchhhhccchHHHhhhhhc
Confidence 46888999999999999999999999999999999885 5677999999999999999999999999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
+... -|.....||++.|+.+-|-..| +.|.|+ ++|+||||||. .+++.+++|+ -...|+++-.+.+|+.
T Consensus 130 n~p~----App~E~~ghtg~Ir~v~wc~eD-~~iLSS---add~tVRLWD~--rTgt~v~sL~-~~s~VtSlEvs~dG~i 198 (334)
T KOG0278|consen 130 NRPK----APPKEISGHTGGIRTVLWCHED-KCILSS---ADDKTVRLWDH--RTGTEVQSLE-FNSPVTSLEVSQDGRI 198 (334)
T ss_pred cCCC----CCchhhcCCCCcceeEEEeccC-ceEEee---ccCCceEEEEe--ccCcEEEEEe-cCCCCcceeeccCCCE
Confidence 9863 4667889999999999999844 666664 59999999998 5888999998 4556888888888876
Q ss_pred h
Q 000080 2381 A 2381 (2389)
Q Consensus 2381 ~ 2381 (2389)
+
T Consensus 199 l 199 (334)
T KOG0278|consen 199 L 199 (334)
T ss_pred E
Confidence 4
No 127
>KOG4283 consensus Transcription-coupled repair protein CSA, contains WD40 domain [Transcription; Replication, recombination and repair]
Probab=99.05 E-value=2.2e-09 Score=124.80 Aligned_cols=145 Identities=13% Similarity=0.123 Sum_probs=117.2
Q ss_pred eeEEEEEEcC-CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCC---EEEEEeCCCcE
Q 000080 2220 ISTRAFSSHP-LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGH---RFASAALDGTV 2295 (2389)
Q Consensus 2220 i~VrsVAFsP-dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~---~LASgS~DgTV 2295 (2389)
-.|.++-|=| |--.+.|+|.|.++|+||..+-+...+|. | .+.|++-+.||-.- .+|+|..|-.|
T Consensus 102 y~iss~~WyP~DtGmFtssSFDhtlKVWDtnTlQ~a~~F~------m-----e~~VYshamSp~a~sHcLiA~gtr~~~V 170 (397)
T KOG4283|consen 102 YAISSAIWYPIDTGMFTSSSFDHTLKVWDTNTLQEAVDFK------M-----EGKVYSHAMSPMAMSHCLIAAGTRDVQV 170 (397)
T ss_pred eeeeeeEEeeecCceeecccccceEEEeecccceeeEEee------c-----CceeehhhcChhhhcceEEEEecCCCcE
Confidence 4667888888 55589999999999999999888877774 2 26799999998763 78889999999
Q ss_pred EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE------------
Q 000080 2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT------------ 2363 (2389)
Q Consensus 2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~------------ 2363 (2389)
||-|+.+|. .-.+++||.+.|.+|.|+|.+.-+|||| |.|++||+||+..+ ..|...|.
T Consensus 171 rLCDi~SGs-----~sH~LsGHr~~vlaV~Wsp~~e~vLatg---saDg~irlWDiRra-sgcf~~lD~hn~k~~p~~~~ 241 (397)
T KOG4283|consen 171 RLCDIASGS-----FSHTLSGHRDGVLAVEWSPSSEWVLATG---SADGAIRLWDIRRA-SGCFRVLDQHNTKRPPILKT 241 (397)
T ss_pred EEEeccCCc-----ceeeeccccCceEEEEeccCceeEEEec---CCCceEEEEEeecc-cceeEEeecccCccCccccc
Confidence 999999983 5578999999999999999665677775 68999999998533 23433333
Q ss_pred --eecCcEEEEeecccchhhhcc
Q 000080 2364 --CHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2364 --GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
.|.+.|..+|..-+|+..+++
T Consensus 242 n~ah~gkvngla~tSd~~~l~~~ 264 (397)
T KOG4283|consen 242 NTAHYGKVNGLAWTSDARYLASC 264 (397)
T ss_pred cccccceeeeeeecccchhhhhc
Confidence 466889999999999987765
No 128
>KOG2096 consensus WD40 repeat protein [General function prediction only]
Probab=99.03 E-value=1.9e-09 Score=126.34 Aligned_cols=116 Identities=16% Similarity=0.195 Sum_probs=93.7
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.|-.+-..-++.+|+|+|.|++|-||+.. |+.+.+.. .. ...-+.-+.||||+++|+++---.|++|.+
T Consensus 189 ~~i~iGiA~~~k~imsas~dt~i~lw~lk-Gq~L~~id---tn-------q~~n~~aavSP~GRFia~~gFTpDVkVwE~ 257 (420)
T KOG2096|consen 189 DIINIGIAGNAKYIMSASLDTKICLWDLK-GQLLQSID---TN-------QSSNYDAAVSPDGRFIAVSGFTPDVKVWEP 257 (420)
T ss_pred ceEEEeecCCceEEEEecCCCcEEEEecC-Cceeeeec---cc-------cccccceeeCCCCcEEEEecCCCCceEEEE
Confidence 34456677789999999999999999985 99887763 11 133466789999999999999999999987
Q ss_pred CCC---CccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2301 EVG---GRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2301 ~tg---grs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
--+ .-.-....+++.||+..|..+|||| +.+.++|+ |.||++||||+
T Consensus 258 ~f~kdG~fqev~rvf~LkGH~saV~~~aFsn-~S~r~vtv---SkDG~wriwdt 307 (420)
T KOG2096|consen 258 IFTKDGTFQEVKRVFSLKGHQSAVLAAAFSN-SSTRAVTV---SKDGKWRIWDT 307 (420)
T ss_pred EeccCcchhhhhhhheeccchhheeeeeeCC-CcceeEEE---ecCCcEEEeec
Confidence 322 1112345788999999999999999 88999998 69999999997
No 129
>KOG1063 consensus RNA polymerase II elongator complex, subunit ELP2, WD repeat superfamily [Chromatin structure and dynamics; Transcription]
Probab=99.03 E-value=9.6e-10 Score=137.79 Aligned_cols=144 Identities=15% Similarity=0.114 Sum_probs=110.3
Q ss_pred eeEEEEEEcCCCCeEEEEeC-----CCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCc
Q 000080 2220 ISTRAFSSHPLRPFFLVGSS-----NTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGT 2294 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~-----DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgT 2294 (2389)
-.|.+++.+|+|+++||+-- ---|+||+..+=..++.+ .||+-.|+.++|||||++|+|+|.|+|
T Consensus 526 yEv~~l~~s~~gnliASaCKS~~~ehAvI~lw~t~~W~~~~~L----------~~HsLTVT~l~FSpdg~~LLsvsRDRt 595 (764)
T KOG1063|consen 526 YEVYALAISPTGNLIASACKSSLKEHAVIRLWNTANWLQVQEL----------EGHSLTVTRLAFSPDGRYLLSVSRDRT 595 (764)
T ss_pred eeEEEEEecCCCCEEeehhhhCCccceEEEEEeccchhhhhee----------cccceEEEEEEECCCCcEEEEeecCce
Confidence 46799999999999999763 345899998766665544 257788999999999999999999999
Q ss_pred EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceE--EEEeecCcEEEE
Q 000080 2295 VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRA--SITCHEGLYDLF 2372 (2389)
Q Consensus 2295 VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~--sL~GH~~~V~sv 2372 (2389)
++||...... ..-..+.....|+..|++..|+| ++..+||| |.|++|++|..-..+.+++. ...-|...|+.+
T Consensus 596 ~sl~~~~~~~-~~e~~fa~~k~HtRIIWdcsW~p-de~~FaTa---SRDK~VkVW~~~~~~d~~i~~~a~~~~~~aVTAv 670 (764)
T KOG1063|consen 596 VSLYEVQEDI-KDEFRFACLKAHTRIIWDCSWSP-DEKYFATA---SRDKKVKVWEEPDLRDKYISRFACLKFSLAVTAV 670 (764)
T ss_pred EEeeeeeccc-chhhhhccccccceEEEEcccCc-ccceeEEe---cCCceEEEEeccCchhhhhhhhchhccCCceeeE
Confidence 9999875431 11122344678999999999999 99999997 79999999997322224432 233478888888
Q ss_pred eecccc
Q 000080 2373 LPLKLL 2378 (2389)
Q Consensus 2373 A~~~~~ 2378 (2389)
+..+.-
T Consensus 671 ~~~~~~ 676 (764)
T KOG1063|consen 671 AYLPVD 676 (764)
T ss_pred Eeeccc
Confidence 776643
No 130
>KOG0639 consensus Transducin-like enhancer of split protein (contains WD40 repeats) [Chromatin structure and dynamics]
Probab=99.03 E-value=5.1e-10 Score=135.91 Aligned_cols=139 Identities=19% Similarity=0.283 Sum_probs=119.3
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
.+++.+||.+...++-.||.|++||+.+...++.|+ ||.+.+.+|.+|+||..|=||+.|+|||-||+++
T Consensus 513 yALa~spDakvcFsccsdGnI~vwDLhnq~~Vrqfq----------GhtDGascIdis~dGtklWTGGlDntvRcWDlre 582 (705)
T KOG0639|consen 513 YALAISPDAKVCFSCCSDGNIAVWDLHNQTLVRQFQ----------GHTDGASCIDISKDGTKLWTGGLDNTVRCWDLRE 582 (705)
T ss_pred hhhhcCCccceeeeeccCCcEEEEEcccceeeeccc----------CCCCCceeEEecCCCceeecCCCccceeehhhhh
Confidence 789999999999999999999999999888888884 6789999999999999999999999999999998
Q ss_pred CCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhh
Q 000080 2303 GGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus 2303 ggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
+. .+..+ .++..|.++.+.| +|.+||.| =+.++|.|=-+ ++...+-|.-|+.-|-+|-|..-|.|-+
T Consensus 583 gr-----qlqqh-dF~SQIfSLg~cP-~~dWlavG---Mens~vevlh~---skp~kyqlhlheScVLSlKFa~cGkwfv 649 (705)
T KOG0639|consen 583 GR-----QLQQH-DFSSQIFSLGYCP-TGDWLAVG---MENSNVEVLHT---SKPEKYQLHLHESCVLSLKFAYCGKWFV 649 (705)
T ss_pred hh-----hhhhh-hhhhhheecccCC-Cccceeee---cccCcEEEEec---CCccceeecccccEEEEEEecccCceee
Confidence 72 22222 3668899999999 99999974 37788888775 3445677777999999999999999988
Q ss_pred cc
Q 000080 2383 SK 2384 (2389)
Q Consensus 2383 s~ 2384 (2389)
|.
T Consensus 650 St 651 (705)
T KOG0639|consen 650 ST 651 (705)
T ss_pred ec
Confidence 74
No 131
>KOG0303 consensus Actin-binding protein Coronin, contains WD40 repeats [Cytoskeleton]
Probab=99.03 E-value=3.4e-09 Score=126.92 Aligned_cols=144 Identities=18% Similarity=0.265 Sum_probs=114.3
Q ss_pred ccccccceeeccccccccccccccCCCC---------cCc--eeEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeE
Q 000080 2189 PGYAGIGASALGWETQDDFEDYVDPPAT---------VEN--ISTRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATAT 2256 (2389)
Q Consensus 2189 ~g~~~~~Asg~~~d~~~~~~~~~d~~at---------v~n--i~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~T 2256 (2389)
|=-|-..||| +-|.+..+|+.-+.-.+ +.+ =+|--|+|||..+ .|+|+|.|.+|.|||+++|+.+.+
T Consensus 91 PfnD~vIASg-SeD~~v~vW~IPe~~l~~~ltepvv~L~gH~rrVg~V~wHPtA~NVLlsag~Dn~v~iWnv~tgeali~ 169 (472)
T KOG0303|consen 91 PFNDCVIASG-SEDTKVMVWQIPENGLTRDLTEPVVELYGHQRRVGLVQWHPTAPNVLLSAGSDNTVSIWNVGTGEALIT 169 (472)
T ss_pred ccCCceeecC-CCCceEEEEECCCcccccCcccceEEEeecceeEEEEeecccchhhHhhccCCceEEEEeccCCceeee
Confidence 5567788999 99999999987322222 111 1567789999866 799999999999999999999888
Q ss_pred ecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCee-EEEEecCCCCEEE
Q 000080 2257 YGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAM-DVSYITSSGSVIA 2335 (2389)
Q Consensus 2257 l~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~-sVAFSP~DGslLA 2335 (2389)
+. |.+.|+++.||-||.+|++++.|..||+||.+++. .+..-.+|.+.=. .+.|.. +|. |+
T Consensus 170 l~-----------hpd~i~S~sfn~dGs~l~TtckDKkvRv~dpr~~~-----~v~e~~~heG~k~~Raifl~-~g~-i~ 231 (472)
T KOG0303|consen 170 LD-----------HPDMVYSMSFNRDGSLLCTTCKDKKVRVIDPRRGT-----VVSEGVAHEGAKPARAIFLA-SGK-IF 231 (472)
T ss_pred cC-----------CCCeEEEEEeccCCceeeeecccceeEEEcCCCCc-----EeeecccccCCCcceeEEec-cCc-ee
Confidence 73 56899999999999999999999999999999973 4444467775433 466887 888 77
Q ss_pred EeecCC-CCCeEEEeeC
Q 000080 2336 AAGHSS-NGINVVVWDT 2351 (2389)
Q Consensus 2336 SAG~sS-~D~TVrLWD~ 2351 (2389)
|+|++- .++++-|||.
T Consensus 232 tTGfsr~seRq~aLwdp 248 (472)
T KOG0303|consen 232 TTGFSRMSERQIALWDP 248 (472)
T ss_pred eeccccccccceeccCc
Confidence 888754 7899999996
No 132
>KOG0294 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.02 E-value=3.2e-09 Score=124.73 Aligned_cols=165 Identities=18% Similarity=0.187 Sum_probs=119.2
Q ss_pred ceeeccccccccccccccC--CCC--cCceeEEEEEEcCCCC--eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCC
Q 000080 2195 GASALGWETQDDFEDYVDP--PAT--VENISTRAFSSHPLRP--FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPP 2268 (2389)
Q Consensus 2195 ~Asg~~~d~~~~~~~~~d~--~at--v~ni~VrsVAFsPdG~--~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~ 2268 (2389)
.||| +-|+++.+-+.... ..+ .+..+|.++.|.|+.. .|+||++||.|.+|+.+.=.++.+++
T Consensus 56 ~aSG-ssDetI~IYDm~k~~qlg~ll~HagsitaL~F~~~~S~shLlS~sdDG~i~iw~~~~W~~~~slK---------- 124 (362)
T KOG0294|consen 56 VASG-SSDETIHIYDMRKRKQLGILLSHAGSITALKFYPPLSKSHLLSGSDDGHIIIWRVGSWELLKSLK---------- 124 (362)
T ss_pred Eecc-CCCCcEEEEeccchhhhcceeccccceEEEEecCCcchhheeeecCCCcEEEEEcCCeEEeeeec----------
Confidence 5667 66666666655311 111 1224679999999876 89999999999999997777888885
Q ss_pred CCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCcc---Ccccceee-----ee------------------------
Q 000080 2269 YALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRS---NVRPMESC-----LC------------------------ 2316 (2389)
Q Consensus 2269 GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs---~~k~l~tl-----~g------------------------ 2316 (2389)
+|.+.|+.|++.|.|+.-.|.+.|+++++||+-+|... +++...++ +|
T Consensus 125 ~H~~~Vt~lsiHPS~KLALsVg~D~~lr~WNLV~Gr~a~v~~L~~~at~v~w~~~Gd~F~v~~~~~i~i~q~d~A~v~~~ 204 (362)
T KOG0294|consen 125 AHKGQVTDLSIHPSGKLALSVGGDQVLRTWNLVRGRVAFVLNLKNKATLVSWSPQGDHFVVSGRNKIDIYQLDNASVFRE 204 (362)
T ss_pred ccccccceeEecCCCceEEEEcCCceeeeehhhcCccceeeccCCcceeeEEcCCCCEEEEEeccEEEEEecccHhHhhh
Confidence 35677999999999999999999999999999876320 00000000 00
Q ss_pred --cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080 2317 --FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus 2317 --Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
.+..+.++.|- ++..|++|| +|++|++||+. ...+...+.+|+++|-.+++-+.
T Consensus 205 i~~~~r~l~~~~l--~~~~L~vG~---d~~~i~~~D~d--s~~~~~~~~AH~~RVK~i~~~~~ 260 (362)
T KOG0294|consen 205 IENPKRILCATFL--DGSELLVGG---DNEWISLKDTD--SDTPLTEFLAHENRVKDIASYTN 260 (362)
T ss_pred hhccccceeeeec--CCceEEEec---CCceEEEeccC--CCccceeeecchhheeeeEEEec
Confidence 11223444454 567888875 89999999984 36778999999999999987654
No 133
>KOG0270 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.02 E-value=3.1e-09 Score=128.85 Aligned_cols=172 Identities=17% Similarity=0.226 Sum_probs=130.3
Q ss_pred cccceeeccccccccccccc--cCCCCcC--ceeEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCce-eeEecccCCCCC
Q 000080 2192 AGIGASALGWETQDDFEDYV--DPPATVE--NISTRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKA-TATYGVLPAANV 2265 (2389)
Q Consensus 2192 ~~~~Asg~~~d~~~~~~~~~--d~~atv~--ni~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~-l~Tl~vl~gh~~ 2265 (2389)
..++||| +-|.+..+|+.. .+.+++. +-.|.+++|||.-+ +|++||.|++|+|.|.+...+ -..+++
T Consensus 256 ~nVLaSg-saD~TV~lWD~~~g~p~~s~~~~~k~Vq~l~wh~~~p~~LLsGs~D~~V~l~D~R~~~~s~~~wk~------ 328 (463)
T KOG0270|consen 256 RNVLASG-SADKTVKLWDVDTGKPKSSITHHGKKVQTLEWHPYEPSVLLSGSYDGTVALKDCRDPSNSGKEWKF------ 328 (463)
T ss_pred ceeEEec-CCCceEEEEEcCCCCcceehhhcCCceeEEEecCCCceEEEeccccceEEeeeccCccccCceEEe------
Confidence 3689999 999999999986 4444443 34679999999755 899999999999999984332 222331
Q ss_pred CCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCC
Q 000080 2266 PPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGI 2344 (2389)
Q Consensus 2266 p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~ 2344 (2389)
.+.|-.|++.|.. +.|.++..||+|+=.|++..+ +|+.++..|...|.++++++..-.+++|+ |.|+
T Consensus 329 -----~g~VEkv~w~~~se~~f~~~tddG~v~~~D~R~~~----~~vwt~~AHd~~ISgl~~n~~~p~~l~t~---s~d~ 396 (463)
T KOG0270|consen 329 -----DGEVEKVAWDPHSENSFFVSTDDGTVYYFDIRNPG----KPVWTLKAHDDEISGLSVNIQTPGLLSTA---STDK 396 (463)
T ss_pred -----ccceEEEEecCCCceeEEEecCCceEEeeecCCCC----CceeEEEeccCCcceEEecCCCCcceeec---cccc
Confidence 2669999999986 788889999999999999865 79999999999999999998777789886 5999
Q ss_pred eEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhh
Q 000080 2345 NVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus 2345 TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
+|+||++.....+.++.-.---+...|.++.|+-.+.|
T Consensus 397 ~Vklw~~~~~~~~~v~~~~~~~~rl~c~~~~~~~a~~l 434 (463)
T KOG0270|consen 397 VVKLWKFDVDSPKSVKEHSFKLGRLHCFALDPDVAFTL 434 (463)
T ss_pred eEEEEeecCCCCcccccccccccceeecccCCCcceEE
Confidence 99999985333333322221223355666666655544
No 134
>KOG1446 consensus Histone H3 (Lys4) methyltransferase complex and RNA cleavage factor II complex, subunit SWD2 [RNA processing and modification; Chromatin structure and dynamics; Posttranslational modification, protein turnover, chaperones]
Probab=99.01 E-value=4.5e-09 Score=123.77 Aligned_cols=164 Identities=15% Similarity=0.133 Sum_probs=126.6
Q ss_pred cccccccccccccCCCC--cCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEE
Q 000080 2200 GWETQDDFEDYVDPPAT--VEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASIS 2275 (2389)
Q Consensus 2200 ~~d~~~~~~~~~d~~at--v~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~ 2275 (2389)
.+|++.|+-...|...- ..+ -.|.+|+.+|-+..++|||.|++|||||++..+|.--+.. ..=.
T Consensus 77 k~d~tIryLsl~dNkylRYF~GH~~~V~sL~~sP~~d~FlS~S~D~tvrLWDlR~~~cqg~l~~------------~~~p 144 (311)
T KOG1446|consen 77 KEDDTIRYLSLHDNKYLRYFPGHKKRVNSLSVSPKDDTFLSSSLDKTVRLWDLRVKKCQGLLNL------------SGRP 144 (311)
T ss_pred CCCCceEEEEeecCceEEEcCCCCceEEEEEecCCCCeEEecccCCeEEeeEecCCCCceEEec------------CCCc
Confidence 67777777766433111 111 2568999999999999999999999999998888665531 1124
Q ss_pred EEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeee---ecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080 2276 ALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCL---CFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2276 sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~---gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
.+||+|.|-.||.|...+.|+|+|++.-++ .|+.++. +-......+.||| ||+.|.-+ ...+.+.|-|.
T Consensus 145 i~AfDp~GLifA~~~~~~~IkLyD~Rs~dk---gPF~tf~i~~~~~~ew~~l~FS~-dGK~iLls---T~~s~~~~lDA- 216 (311)
T KOG1446|consen 145 IAAFDPEGLIFALANGSELIKLYDLRSFDK---GPFTTFSITDNDEAEWTDLEFSP-DGKSILLS---TNASFIYLLDA- 216 (311)
T ss_pred ceeECCCCcEEEEecCCCeEEEEEecccCC---CCceeEccCCCCccceeeeEEcC-CCCEEEEE---eCCCcEEEEEc-
Confidence 679999999999999999999999998642 3555432 3356778999999 89977753 57888999997
Q ss_pred CCCCCceEEEEeecCcE---EEEeecccchhhhcc
Q 000080 2353 APPTSSRASITCHEGLY---DLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2353 ~~tg~~v~sL~GH~~~V---~svA~~~~~~~~~s~ 2384 (2389)
-+|...+++++|++.- -+-.+.|+|.|+|+-
T Consensus 217 -f~G~~~~tfs~~~~~~~~~~~a~ftPds~Fvl~g 250 (311)
T KOG1446|consen 217 -FDGTVKSTFSGYPNAGNLPLSATFTPDSKFVLSG 250 (311)
T ss_pred -cCCcEeeeEeeccCCCCcceeEEECCCCcEEEEe
Confidence 4677789999999876 488899999999874
No 135
>KOG0270 consensus WD40 repeat-containing protein [Function unknown]
Probab=98.99 E-value=2.3e-09 Score=129.90 Aligned_cols=136 Identities=17% Similarity=0.186 Sum_probs=109.0
Q ss_pred EEEEcCC-CCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-CCEEEEEeCCCcEEEeeCC
Q 000080 2224 AFSSHPL-RPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-GHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus 2224 sVAFsPd-G~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~DgTVkLWDl~ 2301 (2389)
+++|+-+ ...|||||.|.||+|||+.+|++.+++. .|...|.+++|.|. +..|.+||.|+||+|-|++
T Consensus 248 ~Ls~n~~~~nVLaSgsaD~TV~lWD~~~g~p~~s~~----------~~~k~Vq~l~wh~~~p~~LLsGs~D~~V~l~D~R 317 (463)
T KOG0270|consen 248 ALSWNRNFRNVLASGSADKTVKLWDVDTGKPKSSIT----------HHGKKVQTLEWHPYEPSVLLSGSYDGTVALKDCR 317 (463)
T ss_pred HHHhccccceeEEecCCCceEEEEEcCCCCcceehh----------hcCCceeEEEecCCCceEEEeccccceEEeeecc
Confidence 4455555 3479999999999999999999999873 36789999999988 5899999999999999999
Q ss_pred CCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080 2302 VGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus 2302 tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
....+ ..... ..+.|..|+|.|.+-..+.+ | ++||+|+=.|+. ..++++.+++.|.++|.+|..+..-
T Consensus 318 ~~~~s--~~~wk---~~g~VEkv~w~~~se~~f~~-~--tddG~v~~~D~R-~~~~~vwt~~AHd~~ISgl~~n~~~ 385 (463)
T KOG0270|consen 318 DPSNS--GKEWK---FDGEVEKVAWDPHSENSFFV-S--TDDGTVYYFDIR-NPGKPVWTLKAHDDEISGLSVNIQT 385 (463)
T ss_pred Ccccc--CceEE---eccceEEEEecCCCceeEEE-e--cCCceEEeeecC-CCCCceeEEEeccCCcceEEecCCC
Confidence 53211 11122 45789999999955444444 3 699999999996 5679999999999999988877653
No 136
>KOG0641 consensus WD40 repeat protein [General function prediction only]
Probab=98.99 E-value=4.3e-09 Score=118.80 Aligned_cols=145 Identities=15% Similarity=0.212 Sum_probs=119.0
Q ss_pred ccccceeeccccccccccccc--cCCCCcC---------ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecc
Q 000080 2191 YAGIGASALGWETQDDFEDYV--DPPATVE---------NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGV 2259 (2389)
Q Consensus 2191 ~~~~~Asg~~~d~~~~~~~~~--d~~atv~---------ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~v 2259 (2389)
..-|-||| +-|.++|+|+.. .-+++++ +-.|.+|+..|.|++|+||-.|....|+|++-|+.++.|.
T Consensus 193 n~~m~~sg-sqdktirfwdlrv~~~v~~l~~~~~~~glessavaav~vdpsgrll~sg~~dssc~lydirg~r~iq~f~- 270 (350)
T KOG0641|consen 193 NGAMFASG-SQDKTIRFWDLRVNSCVNTLDNDFHDGGLESSAVAAVAVDPSGRLLASGHADSSCMLYDIRGGRMIQRFH- 270 (350)
T ss_pred cCcEEEcc-CCCceEEEEeeeccceeeeccCcccCCCcccceeEEEEECCCcceeeeccCCCceEEEEeeCCceeeeeC-
Confidence 45688999 889999999884 2233333 3368999999999999999999999999999999999883
Q ss_pred cCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeec
Q 000080 2260 LPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGH 2339 (2389)
Q Consensus 2260 l~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~ 2339 (2389)
| |++.|++|.|||...++.++|.|..|||=|+.-. ....-++.-...|...+-.+.|+|.+=+.|.|
T Consensus 271 ------p---hsadir~vrfsp~a~yllt~syd~~ikltdlqgd-la~el~~~vv~ehkdk~i~~rwh~~d~sfiss--- 337 (350)
T KOG0641|consen 271 ------P---HSADIRCVRFSPGAHYLLTCSYDMKIKLTDLQGD-LAHELPIMVVAEHKDKAIQCRWHPQDFSFISS--- 337 (350)
T ss_pred ------C---CccceeEEEeCCCceEEEEecccceEEEeecccc-hhhcCceEEEEeccCceEEEEecCccceeeec---
Confidence 1 7899999999999999999999999999999732 11223556667799999999999966566644
Q ss_pred CCCCCeEEEeeC
Q 000080 2340 SSNGINVVVWDT 2351 (2389)
Q Consensus 2340 sS~D~TVrLWD~ 2351 (2389)
|.|+|+.||-+
T Consensus 338 -sadkt~tlwa~ 348 (350)
T KOG0641|consen 338 -SADKTATLWAL 348 (350)
T ss_pred -cCcceEEEecc
Confidence 68999999975
No 137
>KOG2096 consensus WD40 repeat protein [General function prediction only]
Probab=98.98 E-value=1.5e-08 Score=119.04 Aligned_cols=210 Identities=17% Similarity=0.211 Sum_probs=141.5
Q ss_pred CCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEEe
Q 000080 36 APTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAAA 115 (2389)
Q Consensus 36 ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaAS 115 (2389)
+|...+.-++|+.| |. .+|-++++..++.| + ..+|+...--++||.+|.- | -+.|+|.|| -..++.+
T Consensus 84 gH~~~vt~~~FsSd--GK-~lat~~~Dr~Ir~w--~-~~DF~~~eHr~~R~nve~d-h---pT~V~FapD---c~s~vv~ 150 (420)
T KOG2096|consen 84 GHKKEVTDVAFSSD--GK-KLATISGDRSIRLW--D-VRDFENKEHRCIRQNVEYD-H---PTRVVFAPD---CKSVVVS 150 (420)
T ss_pred ccCCceeeeEEcCC--Cc-eeEEEeCCceEEEE--e-cchhhhhhhhHhhccccCC-C---ceEEEECCC---cceEEEE
Confidence 67788888999998 74 67888999999998 4 4456654445778998764 5 689999998 5556643
Q ss_pred --cCCeEEEEeeCCCCC-CCCccceeeEEe----cccceEEEEeecCCCCeEEEEecc--eEEeeccCCcEEEEEEeecc
Q 000080 116 --SENCIFVFAHDSASS-KGSFCWSQNAIL----VQGTKVEAIEWTGSGDGIVAGGME--TVLWKKKNTLWEIAWKFKEN 186 (2389)
Q Consensus 116 --yDntIRVw~~d~~~~-kgd~~W~~~~tL----~hssTV~sIAWSpdG~rLaSggdD--V~IW~~~~s~Wecvwt~~~~ 186 (2389)
.++++++|+.+...+ ++.+.......+ .|.-.|-+|--...|.+|+||+.| |.||+.....-..+ ...
T Consensus 151 ~~~g~~l~vyk~~K~~dG~~~~~~v~~D~~~f~~kh~v~~i~iGiA~~~k~imsas~dt~i~lw~lkGq~L~~i---dtn 227 (420)
T KOG2096|consen 151 VKRGNKLCVYKLVKKTDGSGSHHFVHIDNLEFERKHQVDIINIGIAGNAKYIMSASLDTKICLWDLKGQLLQSI---DTN 227 (420)
T ss_pred EccCCEEEEEEeeecccCCCCcccccccccccchhcccceEEEeecCCceEEEEecCCCcEEEEecCCceeeee---ccc
Confidence 579999998763211 122222222222 156667778889999999999997 99999763333322 222
Q ss_pred ccceEEEEeecCCCc-eEeeec--ccccccCCCCCCCceeEEEeeCCCccce---eecccCCCCeeEEEeccCCCCCCCC
Q 000080 187 YPQNLVSATWSIEGP-SATAAS--MSQLDLLGPKEAGKCVFICCSDGKSEYI---KLELCHPQPVSMVQWRPSTRRHSPG 260 (2389)
Q Consensus 187 ~~~~ivsvaWSpdG~-fATag~--dikf~~~~~~~~~kpV~V~~~dg~~~~~---~ve~aH~qdVn~V~W~Ps~~~~~~~ 260 (2389)
. -+-+.++=||+|. +|+||- |++ +| +|+ +..||+.+.. +...+|...|-..+++|
T Consensus 228 q-~~n~~aavSP~GRFia~~gFTpDVk--Vw------E~~--f~kdG~fqev~rvf~LkGH~saV~~~aFsn-------- 288 (420)
T KOG2096|consen 228 Q-SSNYDAAVSPDGRFIAVSGFTPDVK--VW------EPI--FTKDGTFQEVKRVFSLKGHQSAVLAAAFSN-------- 288 (420)
T ss_pred c-ccccceeeCCCCcEEEEecCCCCce--EE------EEE--eccCcchhhhhhhheeccchhheeeeeeCC--------
Confidence 2 2334445599999 666655 544 11 111 1124443222 23589999999999999
Q ss_pred CCccccCceEEeeecCCeEEEEEee
Q 000080 261 DTKRSQRHVLLTCCLDGTVRLWCEM 285 (2389)
Q Consensus 261 Dgk~~~~nILAScSdDgTVRLW~e~ 285 (2389)
++.+ .+|.|.||++|||+.+
T Consensus 289 ~S~r-----~vtvSkDG~wriwdtd 308 (420)
T KOG2096|consen 289 SSTR-----AVTVSKDGKWRIWDTD 308 (420)
T ss_pred Ccce-----eEEEecCCcEEEeecc
Confidence 4444 9999999999999955
No 138
>KOG1445 consensus Tumor-specific antigen (contains WD repeats) [Cytoskeleton]
Probab=98.97 E-value=8.4e-10 Score=136.10 Aligned_cols=120 Identities=16% Similarity=0.252 Sum_probs=99.1
Q ss_pred eEEEEEEcC-CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEe
Q 000080 2221 STRAFSSHP-LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTW 2298 (2389)
Q Consensus 2221 ~VrsVAFsP-dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLW 2298 (2389)
-|..+.|.| |.+.||.|.+||.|+||-+..+..-.... .|.. -..+|...|+++.|.|-. +.||+++.|.||+||
T Consensus 629 ~vtDl~WdPFD~~rLAVa~ddg~i~lWr~~a~gl~e~~~-tPe~--~lt~h~eKI~slRfHPLAadvLa~asyd~Ti~lW 705 (1012)
T KOG1445|consen 629 LVTDLHWDPFDDERLAVATDDGQINLWRLTANGLPENEM-TPEK--ILTIHGEKITSLRFHPLAADVLAVASYDSTIELW 705 (1012)
T ss_pred eeeecccCCCChHHeeecccCceEEEEEeccCCCCcccC-Ccce--eeecccceEEEEEecchhhhHhhhhhccceeeee
Confidence 468889999 67789999999999999987664321111 0111 134678999999999985 899999999999999
Q ss_pred eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080 2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
|+.++ +....+.||++.|.++|||| ||+++||. +.|++||+++..
T Consensus 706 Dl~~~-----~~~~~l~gHtdqIf~~AWSp-dGr~~AtV---cKDg~~rVy~Pr 750 (1012)
T KOG1445|consen 706 DLANA-----KLYSRLVGHTDQIFGIAWSP-DGRRIATV---CKDGTLRVYEPR 750 (1012)
T ss_pred ehhhh-----hhhheeccCcCceeEEEECC-CCcceeee---ecCceEEEeCCC
Confidence 99987 45678899999999999999 99999998 499999999973
No 139
>KOG1007 consensus WD repeat protein TSSC1, WD repeat superfamily [Function unknown]
Probab=98.96 E-value=3.7e-09 Score=122.93 Aligned_cols=144 Identities=13% Similarity=0.150 Sum_probs=112.3
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCce-eeEecccCCCCCCCCCCCCCEEEEEECC--CCCEEEEEeCCCcEEE
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKA-TATYGVLPAANVPPPYALASISALQFDH--YGHRFASAALDGTVCT 2297 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~-l~Tl~vl~gh~~p~~GH~~~V~sVaFSP--DG~~LASgS~DgTVkL 2297 (2389)
.|.+|-|+||+.-+|+- .|..|-+|++..+.. ++.+. .++ ..+|....++=++|| ||+.+|+.+ |+|++.
T Consensus 125 ~i~cvew~Pns~klasm-~dn~i~l~~l~ess~~vaev~-ss~----s~e~~~~ftsg~WspHHdgnqv~tt~-d~tl~~ 197 (370)
T KOG1007|consen 125 KINCVEWEPNSDKLASM-DDNNIVLWSLDESSKIVAEVL-SSE----SAEMRHSFTSGAWSPHHDGNQVATTS-DSTLQF 197 (370)
T ss_pred ceeeEEEcCCCCeeEEe-ccCceEEEEcccCcchheeec-ccc----cccccceecccccCCCCccceEEEeC-CCcEEE
Confidence 45899999999999986 488999999988875 33332 112 234567788889998 799999876 699999
Q ss_pred eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080 2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus 2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
||++|.. +...--.+|...|+++.|+|+--.+|||+| +|+-|||||+. .+...++.|.+|+.+||+|-+.|.
T Consensus 198 ~D~RT~~----~~~sI~dAHgq~vrdlDfNpnkq~~lvt~g---DdgyvriWD~R-~tk~pv~el~~HsHWvW~VRfn~~ 269 (370)
T KOG1007|consen 198 WDLRTMK----KNNSIEDAHGQRVRDLDFNPNKQHILVTCG---DDGYVRIWDTR-KTKFPVQELPGHSHWVWAVRFNPE 269 (370)
T ss_pred EEccchh----hhcchhhhhcceeeeccCCCCceEEEEEcC---CCccEEEEecc-CCCccccccCCCceEEEEEEecCc
Confidence 9999863 222223568889999999995555788865 99999999996 345569999999999999999886
Q ss_pred ch
Q 000080 2378 LN 2379 (2389)
Q Consensus 2378 ~~ 2379 (2389)
-+
T Consensus 270 hd 271 (370)
T KOG1007|consen 270 HD 271 (370)
T ss_pred cc
Confidence 44
No 140
>KOG4328 consensus WD40 protein [Function unknown]
Probab=98.96 E-value=2.6e-09 Score=129.68 Aligned_cols=161 Identities=18% Similarity=0.179 Sum_probs=118.6
Q ss_pred CCcCceeEEEEEEcCCCC--eEEEEeCCCcEEEeecCCCcee-eEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEe
Q 000080 2215 ATVENISTRAFSSHPLRP--FFLVGSSNTHIYLWEFGKDKAT-ATYGVLPAANVPPPYALASISALQFDHYG-HRFASAA 2290 (2389)
Q Consensus 2215 atv~ni~VrsVAFsPdG~--~LASGS~DgTIRLWDl~tGk~l-~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS 2290 (2389)
+-+..-+|.+++|||.-+ ++|+|.--|+|-+||+++.+.. .... -+ .+|+..|.++.|+|.. .++.+.|
T Consensus 182 ~kv~~~Rit~l~fHPt~~~~lva~GdK~G~VG~Wn~~~~~~d~d~v~--~f-----~~hs~~Vs~l~F~P~n~s~i~ssS 254 (498)
T KOG4328|consen 182 AKVTDRRITSLAFHPTENRKLVAVGDKGGQVGLWNFGTQEKDKDGVY--LF-----TPHSGPVSGLKFSPANTSQIYSSS 254 (498)
T ss_pred eEecccceEEEEecccCcceEEEEccCCCcEEEEecCCCCCccCceE--Ee-----ccCCccccceEecCCChhheeeec
Confidence 334444779999999765 8999999999999999532221 1111 11 2478999999999986 7999999
Q ss_pred CCCcEEEeeCCCCCc----------------------------------------cCcccceeeeecCCCeeEEEEecCC
Q 000080 2291 LDGTVCTWQLEVGGR----------------------------------------SNVRPMESCLCFSSHAMDVSYITSS 2330 (2389)
Q Consensus 2291 ~DgTVkLWDl~tggr----------------------------------------s~~k~l~tl~gHs~~V~sVAFSP~D 2330 (2389)
.|||||+=|++.+.- ..-..+..+.-|...|.+|+++|-.
T Consensus 255 yDGtiR~~D~~~~i~e~v~s~~~d~~~fs~~d~~~e~~~vl~~~~~G~f~~iD~R~~~s~~~~~~lh~kKI~sv~~NP~~ 334 (498)
T KOG4328|consen 255 YDGTIRLQDFEGNISEEVLSLDTDNIWFSSLDFSAESRSVLFGDNVGNFNVIDLRTDGSEYENLRLHKKKITSVALNPVC 334 (498)
T ss_pred cCceeeeeeecchhhHHHhhcCccceeeeeccccCCCccEEEeecccceEEEEeecCCccchhhhhhhcccceeecCCCC
Confidence 999999988875410 0001223344588899999999977
Q ss_pred CCEEEEeecCCCCCeEEEeeCCCCCCCc--eEEEEeecCcEEEEeecccchhhhccc
Q 000080 2331 GSVIAAAGHSSNGINVVVWDTLAPPTSS--RASITCHEGLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus 2331 GslLASAG~sS~D~TVrLWD~l~~tg~~--v~sL~GH~~~V~svA~~~~~~~~~s~~ 2385 (2389)
-.+|||| |.|+|+||||+..-.++. +-+...|.-.|.+..+||+|-..|..|
T Consensus 335 p~~laT~---s~D~T~kIWD~R~l~~K~sp~lst~~HrrsV~sAyFSPs~gtl~TT~ 388 (498)
T KOG4328|consen 335 PWFLATA---SLDQTAKIWDLRQLRGKASPFLSTLPHRRSVNSAYFSPSGGTLLTTC 388 (498)
T ss_pred chheeec---ccCcceeeeehhhhcCCCCcceecccccceeeeeEEcCCCCceEeec
Confidence 7899997 599999999985322222 233445999999999999998888766
No 141
>KOG1445 consensus Tumor-specific antigen (contains WD repeats) [Cytoskeleton]
Probab=98.96 E-value=3.4e-09 Score=130.90 Aligned_cols=150 Identities=17% Similarity=0.236 Sum_probs=119.6
Q ss_pred EEcCCCCeEEE--EeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCC
Q 000080 2226 SSHPLRPFFLV--GSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus 2226 AFsPdG~~LAS--GS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~t 2302 (2389)
-|+.+..++|. +|..|.|-|+|+...-.+ |+.-||..-...-|+.++++|-. ++||.|.+||.|+||.+.+
T Consensus 586 Gfcan~~rvAVPL~g~gG~iai~el~~PGrL------PDgv~p~l~Ngt~vtDl~WdPFD~~rLAVa~ddg~i~lWr~~a 659 (1012)
T KOG1445|consen 586 GFCANNKRVAVPLAGSGGVIAIYELNEPGRL------PDGVMPGLFNGTLVTDLHWDPFDDERLAVATDDGQINLWRLTA 659 (1012)
T ss_pred ceeeccceEEEEecCCCceEEEEEcCCCCCC------CcccccccccCceeeecccCCCChHHeeecccCceEEEEEecc
Confidence 47777777665 567889999999754332 23233433344679999999864 8999999999999999988
Q ss_pred CCcc--CcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080 2303 GGRS--NVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus 2303 ggrs--~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
+|.+ ...|-..+.+|...|+++.|+|=-..+||++ |.|-||+|||+ ++++..-+|+||+++|-.+|-||+|+.
T Consensus 660 ~gl~e~~~tPe~~lt~h~eKI~slRfHPLAadvLa~a---syd~Ti~lWDl--~~~~~~~~l~gHtdqIf~~AWSpdGr~ 734 (1012)
T KOG1445|consen 660 NGLPENEMTPEKILTIHGEKITSLRFHPLAADVLAVA---SYDSTIELWDL--ANAKLYSRLVGHTDQIFGIAWSPDGRR 734 (1012)
T ss_pred CCCCcccCCcceeeecccceEEEEEecchhhhHhhhh---hccceeeeeeh--hhhhhhheeccCcCceeEEEECCCCcc
Confidence 7521 1134456889999999999999766788887 68999999998 566777899999999999999999999
Q ss_pred hhcccc
Q 000080 2381 ALSKCR 2386 (2389)
Q Consensus 2381 ~~s~~~ 2386 (2389)
+-+-|.
T Consensus 735 ~AtVcK 740 (1012)
T KOG1445|consen 735 IATVCK 740 (1012)
T ss_pred eeeeec
Confidence 999885
No 142
>COG2319 FOG: WD40 repeat [General function prediction only]
Probab=98.95 E-value=1.3e-08 Score=114.28 Aligned_cols=139 Identities=20% Similarity=0.325 Sum_probs=110.0
Q ss_pred EEEEEE-cCCCC-eEEEEeC-CCcEEEeecCC-CceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-CCcEE
Q 000080 2222 TRAFSS-HPLRP-FFLVGSS-NTHIYLWEFGK-DKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-DGTVC 2296 (2389)
Q Consensus 2222 VrsVAF-sPdG~-~LASGS~-DgTIRLWDl~t-Gk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-DgTVk 2296 (2389)
+..+.+ ++++. +++..+. |+++++||+.. +.....+. +|...|..++|+|+|+.+++++. |++++
T Consensus 112 ~~~~~~~~~~~~~~~~~~~~~d~~~~~~~~~~~~~~~~~~~----------~~~~~v~~~~~~~~~~~~~~~~~~~~~~~ 181 (466)
T COG2319 112 VSKLALSSPDGNSILLASSSLDGTVKLWDLSTPGKLIRTLE----------GHSESVTSLAFSPDGKLLASGSSLDGTIK 181 (466)
T ss_pred eeeEEEECCCcceEEeccCCCCccEEEEEecCCCeEEEEEe----------cCcccEEEEEECCCCCEEEecCCCCCceE
Confidence 455566 89998 5665455 99999999976 55555553 46688999999999999999986 99999
Q ss_pred EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCC-EEEEeecCCCCCeEEEeeCCCCCCCceE-EEEeecCcEEEEee
Q 000080 2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGS-VIAAAGHSSNGINVVVWDTLAPPTSSRA-SITCHEGLYDLFLP 2374 (2389)
Q Consensus 2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGs-lLASAG~sS~D~TVrLWD~l~~tg~~v~-sL~GH~~~V~svA~ 2374 (2389)
+|++.++ ..+.++.+|...|.+++|+| +|. .++++ +.|++|++||.. .+..+. .+.+|...+ .-.+
T Consensus 182 ~~~~~~~-----~~~~~~~~~~~~v~~~~~~~-~~~~~~~~~---~~d~~i~~wd~~--~~~~~~~~~~~~~~~~-~~~~ 249 (466)
T COG2319 182 LWDLRTG-----KPLSTLAGHTDPVSSLAFSP-DGGLLIASG---SSDGTIRLWDLS--TGKLLRSTLSGHSDSV-VSSF 249 (466)
T ss_pred EEEcCCC-----ceEEeeccCCCceEEEEEcC-CcceEEEEe---cCCCcEEEEECC--CCcEEeeecCCCCcce-eEeE
Confidence 9999974 46778888999999999998 887 55542 589999999873 566677 799999986 4477
Q ss_pred cccchhhh
Q 000080 2375 LKLLNFAL 2382 (2389)
Q Consensus 2375 ~~~~~~~~ 2382 (2389)
++++.+.+
T Consensus 250 ~~~~~~~~ 257 (466)
T COG2319 250 SPDGSLLA 257 (466)
T ss_pred CCCCCEEE
Confidence 77775444
No 143
>KOG0305 consensus Anaphase promoting complex, Cdc20, Cdh1, and Ama1 subunits [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=98.95 E-value=1.3e-08 Score=127.46 Aligned_cols=203 Identities=16% Similarity=0.315 Sum_probs=137.9
Q ss_pred ccCCCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcE
Q 000080 33 IPTAPTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQL 112 (2389)
Q Consensus 33 ip~ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeI 112 (2389)
+--.|..-.+.++|... .+..|+++..++-+ + .+.-....+ ++.+|. +.|+..+|+|| +..
T Consensus 255 ~~~~h~~rvg~laW~~~-----~lssGsr~~~I~~~--d-----vR~~~~~~~-~~~~H~--qeVCgLkws~d----~~~ 315 (484)
T KOG0305|consen 255 LRGSHASRVGSLAWNSS-----VLSSGSRDGKILNH--D-----VRISQHVVS-TLQGHR--QEVCGLKWSPD----GNQ 315 (484)
T ss_pred ccCCcCceeEEEeccCc-----eEEEecCCCcEEEE--E-----Eecchhhhh-hhhccc--ceeeeeEECCC----CCe
Confidence 33347888899999943 67777777766555 2 111111222 456664 58999999998 555
Q ss_pred EEe--cCCeEEEEeeCCCCCCCCccceeeEEe-cccceEEEEeecCCCCeEE-EEec--c--eEEeeccCCcEE-EEEEe
Q 000080 113 AAA--SENCIFVFAHDSASSKGSFCWSQNAIL-VQGTKVEAIEWTGSGDGIV-AGGM--E--TVLWKKKNTLWE-IAWKF 183 (2389)
Q Consensus 113 aAS--yDntIRVw~~d~~~~kgd~~W~~~~tL-~hssTV~sIAWSpdG~rLa-Sggd--D--V~IW~~~~s~We-cvwt~ 183 (2389)
+|| .||.+.||... +.....++ .|+..|.+++|.|--..|+ +||. | +++|+..++.-. ++
T Consensus 316 lASGgnDN~~~Iwd~~--------~~~p~~~~~~H~aAVKA~awcP~q~~lLAsGGGs~D~~i~fwn~~~g~~i~~v--- 384 (484)
T KOG0305|consen 316 LASGGNDNVVFIWDGL--------SPEPKFTFTEHTAAVKALAWCPWQSGLLATGGGSADRCIKFWNTNTGARIDSV--- 384 (484)
T ss_pred eccCCCccceEeccCC--------CccccEEEeccceeeeEeeeCCCccCceEEcCCCcccEEEEEEcCCCcEeccc---
Confidence 554 48999999864 12223333 5999999999999877555 6655 2 999997755432 23
Q ss_pred eccccceEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCC
Q 000080 184 KENYPQNLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDT 262 (2389)
Q Consensus 184 ~~~~~~~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dg 262 (2389)
+..--|-++.||+... |+|+-+... +-+-||.+.. ........+|+..|-..+|+| ||
T Consensus 385 --dtgsQVcsL~Wsk~~kEi~sthG~s~----------n~i~lw~~ps-~~~~~~l~gH~~RVl~la~SP--------dg 443 (484)
T KOG0305|consen 385 --DTGSQVCSLIWSKKYKELLSTHGYSE----------NQITLWKYPS-MKLVAELLGHTSRVLYLALSP--------DG 443 (484)
T ss_pred --ccCCceeeEEEcCCCCEEEEecCCCC----------CcEEEEeccc-cceeeeecCCcceeEEEEECC--------CC
Confidence 2223355889999986 888877532 1233343322 222334589999999999999 88
Q ss_pred ccccCceEEeeecCCeEEEEEeecCCccc
Q 000080 263 KRSQRHVLLTCCLDGTVRLWCEMDSGKTR 291 (2389)
Q Consensus 263 k~~~~nILAScSdDgTVRLW~e~d~Gk~k 291 (2389)
.. ++|++.|.|+|+|..-+..+.+
T Consensus 444 ~~-----i~t~a~DETlrfw~~f~~~~~~ 467 (484)
T KOG0305|consen 444 ET-----IVTGAADETLRFWNLFDERPKS 467 (484)
T ss_pred CE-----EEEecccCcEEeccccCCCCcc
Confidence 88 9999999999999988865543
No 144
>KOG1539 consensus WD repeat protein [General function prediction only]
Probab=98.94 E-value=2.2e-09 Score=136.62 Aligned_cols=142 Identities=19% Similarity=0.303 Sum_probs=113.9
Q ss_pred ccccccceeeccccccccccccccC--CCCcC-ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC
Q 000080 2189 PGYAGIGASALGWETQDDFEDYVDP--PATVE-NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV 2265 (2389)
Q Consensus 2189 ~g~~~~~Asg~~~d~~~~~~~~~d~--~atv~-ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~ 2265 (2389)
-|-.....++ +.+..-.+|+|... ..+++ ..++..+..|.....+|.+-+|-.|++.|..+-+-++.|.
T Consensus 502 D~~n~~~vsa-~~~Gilkfw~f~~k~l~~~l~l~~~~~~iv~hr~s~l~a~~~ddf~I~vvD~~t~kvvR~f~------- 573 (910)
T KOG1539|consen 502 DGTNRLLVSA-GADGILKFWDFKKKVLKKSLRLGSSITGIVYHRVSDLLAIALDDFSIRVVDVVTRKVVREFW------- 573 (910)
T ss_pred cCCCceEEEc-cCcceEEEEecCCcceeeeeccCCCcceeeeeehhhhhhhhcCceeEEEEEchhhhhhHHhh-------
Confidence 3344456667 78888899999633 23332 2456778899999999999999999999998888887774
Q ss_pred CCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCe
Q 000080 2266 PPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGIN 2345 (2389)
Q Consensus 2266 p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~T 2345 (2389)
||.+.|++..|||||++|++++.|+|||+||+-++. .+-. ......+.++.||| +|.+|||+- .+.+-
T Consensus 574 ---gh~nritd~~FS~DgrWlisasmD~tIr~wDlpt~~-----lID~-~~vd~~~~sls~SP-ngD~LAT~H--vd~~g 641 (910)
T KOG1539|consen 574 ---GHGNRITDMTFSPDGRWLISASMDSTIRTWDLPTGT-----LIDG-LLVDSPCTSLSFSP-NGDFLATVH--VDQNG 641 (910)
T ss_pred ---ccccceeeeEeCCCCcEEEEeecCCcEEEEeccCcc-----eeee-EecCCcceeeEECC-CCCEEEEEE--ecCce
Confidence 578999999999999999999999999999999973 3333 23567888999999 999999983 34477
Q ss_pred EEEee
Q 000080 2346 VVVWD 2350 (2389)
Q Consensus 2346 VrLWD 2350 (2389)
|.||-
T Consensus 642 IylWs 646 (910)
T KOG1539|consen 642 IYLWS 646 (910)
T ss_pred EEEEE
Confidence 99997
No 145
>PF08662 eIF2A: Eukaryotic translation initiation factor eIF2A; InterPro: IPR013979 This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins.
Probab=98.94 E-value=1.3e-08 Score=114.73 Aligned_cols=139 Identities=13% Similarity=0.156 Sum_probs=99.6
Q ss_pred EEEEEcCCCCeEEEEeC---C-------CcEEEeecC-CCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe-
Q 000080 2223 RAFSSHPLRPFFLVGSS---N-------THIYLWEFG-KDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA- 2290 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~---D-------gTIRLWDl~-tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS- 2290 (2389)
-.+.|||+|.+|+.-.+ | +...||-++ .+..+..+. ....+.|.+++|+|+|+.||...
T Consensus 9 ~~~~W~~~G~~l~~~~~~~~~~~~ks~~~~~~l~~~~~~~~~~~~i~---------l~~~~~I~~~~WsP~g~~favi~g 79 (194)
T PF08662_consen 9 AKLHWQPSGDYLLVKVQTRVDKSGKSYYGEFELFYLNEKNIPVESIE---------LKKEGPIHDVAWSPNGNEFAVIYG 79 (194)
T ss_pred EEEEecccCCEEEEEEEEeeccCcceEEeeEEEEEEecCCCccceee---------ccCCCceEEEEECcCCCEEEEEEc
Confidence 45789999997655333 1 235555552 222333332 11235699999999999987654
Q ss_pred -CCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcE
Q 000080 2291 -LDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLY 2369 (2389)
Q Consensus 2291 -~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V 2369 (2389)
.++.|.|||++. +++.++ +...++.|.|+| +|++||+||++...|.|++||+. +.+.+.+++ | ..+
T Consensus 80 ~~~~~v~lyd~~~------~~i~~~--~~~~~n~i~wsP-~G~~l~~~g~~n~~G~l~~wd~~--~~~~i~~~~-~-~~~ 146 (194)
T PF08662_consen 80 SMPAKVTLYDVKG------KKIFSF--GTQPRNTISWSP-DGRFLVLAGFGNLNGDLEFWDVR--KKKKISTFE-H-SDA 146 (194)
T ss_pred cCCcccEEEcCcc------cEeEee--cCCCceEEEECC-CCCEEEEEEccCCCcEEEEEECC--CCEEeeccc-c-CcE
Confidence 578999999973 355555 456788999999 99999999987777899999983 445565554 3 358
Q ss_pred EEEeecccchhhhc
Q 000080 2370 DLFLPLKLLNFALS 2383 (2389)
Q Consensus 2370 ~svA~~~~~~~~~s 2383 (2389)
+.++.+|+|++.++
T Consensus 147 t~~~WsPdGr~~~t 160 (194)
T PF08662_consen 147 TDVEWSPDGRYLAT 160 (194)
T ss_pred EEEEEcCCCCEEEE
Confidence 89999999999876
No 146
>KOG1274 consensus WD40 repeat protein [General function prediction only]
Probab=98.94 E-value=6.2e-09 Score=133.89 Aligned_cols=141 Identities=14% Similarity=0.156 Sum_probs=111.7
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
++|.++|+-+|.++|.||+|..||+=+..++....+++ ||.+.|.+|.|+|+|++||+.+.||+|++||+
T Consensus 98 p~r~~~v~g~g~~iaagsdD~~vK~~~~~D~s~~~~lr----------gh~apVl~l~~~p~~~fLAvss~dG~v~iw~~ 167 (933)
T KOG1274|consen 98 PIRDLAVSGSGKMIAAGSDDTAVKLLNLDDSSQEKVLR----------GHDAPVLQLSYDPKGNFLAVSSCDGKVQIWDL 167 (933)
T ss_pred cceEEEEecCCcEEEeecCceeEEEEeccccchheeec----------ccCCceeeeeEcCCCCEEEEEecCceEEEEEc
Confidence 45889999999999999999999999998888888876 57799999999999999999999999999999
Q ss_pred CCCCccCcccceeeee--------cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEE--EeecCcEE
Q 000080 2301 EVGGRSNVRPMESCLC--------FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASI--TCHEGLYD 2370 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~g--------Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL--~GH~~~V~ 2370 (2389)
.++. ...++.+ -+..+.-++|+|++|++++- +.|++|++++.. .......| .-|...+.
T Consensus 168 ~~~~-----~~~tl~~v~k~n~~~~s~i~~~~aW~Pk~g~la~~----~~d~~Vkvy~r~--~we~~f~Lr~~~~ss~~~ 236 (933)
T KOG1274|consen 168 QDGI-----LSKTLTGVDKDNEFILSRICTRLAWHPKGGTLAVP----PVDNTVKVYSRK--GWELQFKLRDKLSSSKFS 236 (933)
T ss_pred ccch-----hhhhcccCCccccccccceeeeeeecCCCCeEEee----ccCCeEEEEccC--CceeheeecccccccceE
Confidence 9863 1122211 13456679999955666665 389999999972 33334444 34566699
Q ss_pred EEeecccchhhh
Q 000080 2371 LFLPLKLLNFAL 2382 (2389)
Q Consensus 2371 svA~~~~~~~~~ 2382 (2389)
+++.+|.|.++-
T Consensus 237 ~~~wsPnG~YiA 248 (933)
T KOG1274|consen 237 DLQWSPNGKYIA 248 (933)
T ss_pred EEEEcCCCcEEe
Confidence 999999998753
No 147
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=98.92 E-value=8.1e-09 Score=129.74 Aligned_cols=147 Identities=18% Similarity=0.264 Sum_probs=116.4
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
..||+++.+|.+..++.|++||.++..+.+.++.... +.+ +-..++|-+|+|+|+|.++|+|+.||.|++||
T Consensus 111 g~IWsiai~p~~~~l~IgcddGvl~~~s~~p~~I~~~-r~l-------~rq~sRvLslsw~~~~~~i~~Gs~Dg~Iriwd 182 (691)
T KOG2048|consen 111 GAIWSIAINPENTILAIGCDDGVLYDFSIGPDKITYK-RSL-------MRQKSRVLSLSWNPTGTKIAGGSIDGVIRIWD 182 (691)
T ss_pred cceeEEEeCCccceEEeecCCceEEEEecCCceEEEE-eec-------ccccceEEEEEecCCccEEEecccCceEEEEE
Confidence 5679999999999999999999999999988875432 111 12358899999999999999999999999999
Q ss_pred CCCCCccCccc-ceeeee----cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080 2300 LEVGGRSNVRP-MESCLC----FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus 2300 l~tggrs~~k~-l~tl~g----Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
+.++. .. +. ...+.+ -...|++|.|-. | ..||+| -.-|+|+.||. .+++.++++.+|.+.|.|+|.
T Consensus 183 ~~~~~-t~-~~~~~~~d~l~k~~~~iVWSv~~Lr-d-~tI~sg---DS~G~V~FWd~--~~gTLiqS~~~h~adVl~Lav 253 (691)
T KOG2048|consen 183 VKSGQ-TL-HIITMQLDRLSKREPTIVWSVLFLR-D-STIASG---DSAGTVTFWDS--IFGTLIQSHSCHDADVLALAV 253 (691)
T ss_pred cCCCc-eE-EEeeecccccccCCceEEEEEEEee-c-CcEEEe---cCCceEEEEcc--cCcchhhhhhhhhcceeEEEE
Confidence 99873 11 10 011111 345789999997 6 457775 24589999997 578889999999999999999
Q ss_pred cccchhhhc
Q 000080 2375 LKLLNFALS 2383 (2389)
Q Consensus 2375 ~~~~~~~~s 2383 (2389)
.+++|+..|
T Consensus 254 ~~~~d~vfs 262 (691)
T KOG2048|consen 254 ADNEDRVFS 262 (691)
T ss_pred cCCCCeEEE
Confidence 999887665
No 148
>KOG0771 consensus Prolactin regulatory element-binding protein/Protein transport protein SEC12p [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.91 E-value=5.9e-09 Score=126.09 Aligned_cols=144 Identities=15% Similarity=0.200 Sum_probs=108.4
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
..|+|+++|..+++|+.||++|+||+.+-..+... + .|...|..+.|||||++||+-+.| ..++||+++
T Consensus 148 k~vaf~~~gs~latgg~dg~lRv~~~Ps~~t~l~e---~-------~~~~eV~DL~FS~dgk~lasig~d-~~~VW~~~~ 216 (398)
T KOG0771|consen 148 KVVAFNGDGSKLATGGTDGTLRVWEWPSMLTILEE---I-------AHHAEVKDLDFSPDGKFLASIGAD-SARVWSVNT 216 (398)
T ss_pred eEEEEcCCCCEeeeccccceEEEEecCcchhhhhh---H-------hhcCccccceeCCCCcEEEEecCC-ceEEEEecc
Confidence 67899999999999999999999998655544333 1 355899999999999999999999 999999999
Q ss_pred CCc----c----------------C----cc------c---c-----eeeee-----------cCCCeeEEEEecCCCCE
Q 000080 2303 GGR----S----------------N----VR------P---M-----ESCLC-----------FSSHAMDVSYITSSGSV 2333 (2389)
Q Consensus 2303 ggr----s----------------~----~k------~---l-----~tl~g-----------Hs~~V~sVAFSP~DGsl 2333 (2389)
|-. . + ++ + + ..+.+ --..|++++.+. ||++
T Consensus 217 g~~~a~~t~~~k~~~~~~cRF~~d~~~~~l~laa~~~~~~~v~~~~~~~w~~~~~l~~~~~~~~~~siSsl~VS~-dGkf 295 (398)
T KOG0771|consen 217 GAALARKTPFSKDEMFSSCRFSVDNAQETLRLAASQFPGGGVRLCDISLWSGSNFLRLRKKIKRFKSISSLAVSD-DGKF 295 (398)
T ss_pred CchhhhcCCcccchhhhhceecccCCCceEEEEEecCCCCceeEEEeeeeccccccchhhhhhccCcceeEEEcC-CCcE
Confidence 710 0 0 00 0 0 00000 013688999999 9999
Q ss_pred EEEeecCCCCCeEEEeeCCCCCCCceEEE-EeecCcEEEEeecccchhhhc
Q 000080 2334 IAAAGHSSNGINVVVWDTLAPPTSSRASI-TCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2334 LASAG~sS~D~TVrLWD~l~~tg~~v~sL-~GH~~~V~svA~~~~~~~~~s 2383 (2389)
+|-| +.||.|-|.++. .=++++-. +.|..-|+.|.++|+-+.-.|
T Consensus 296 ~AlG---T~dGsVai~~~~--~lq~~~~vk~aH~~~VT~ltF~Pdsr~~~s 341 (398)
T KOG0771|consen 296 LALG---TMDGSVAIYDAK--SLQRLQYVKEAHLGFVTGLTFSPDSRYLAS 341 (398)
T ss_pred EEEe---ccCCcEEEEEec--eeeeeEeehhhheeeeeeEEEcCCcCcccc
Confidence 9986 589999999972 22333332 669999999999999876554
No 149
>KOG1007 consensus WD repeat protein TSSC1, WD repeat superfamily [Function unknown]
Probab=98.90 E-value=5.4e-09 Score=121.59 Aligned_cols=139 Identities=14% Similarity=0.110 Sum_probs=112.3
Q ss_pred EEEEEcC--CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEee
Q 000080 2223 RAFSSHP--LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2223 rsVAFsP--dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWD 2299 (2389)
.+=+|+| ||..+++. .|++++.||+++.++..... .+ |...|+.+-|+|+- ..||||++||.||+||
T Consensus 174 tsg~WspHHdgnqv~tt-~d~tl~~~D~RT~~~~~sI~--dA-------Hgq~vrdlDfNpnkq~~lvt~gDdgyvriWD 243 (370)
T KOG1007|consen 174 TSGAWSPHHDGNQVATT-SDSTLQFWDLRTMKKNNSIE--DA-------HGQRVRDLDFNPNKQHILVTCGDDGYVRIWD 243 (370)
T ss_pred cccccCCCCccceEEEe-CCCcEEEEEccchhhhcchh--hh-------hcceeeeccCCCCceEEEEEcCCCccEEEEe
Confidence 3447888 78888875 68999999999888766654 22 56889999999996 6899999999999999
Q ss_pred CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCC--------------------------
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLA-------------------------- 2353 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~-------------------------- 2353 (2389)
.+... .|++++.+|+.+|++|.|+|.-.++|.|+ +.|..|-||-...
T Consensus 244 ~R~tk----~pv~el~~HsHWvW~VRfn~~hdqLiLs~---~SDs~V~Lsca~svSSE~qi~~~~dese~e~~dseer~k 316 (370)
T KOG1007|consen 244 TRKTK----FPVQELPGHSHWVWAVRFNPEHDQLILSG---GSDSAVNLSCASSVSSEQQIEFEDDESESEDEDSEERVK 316 (370)
T ss_pred ccCCC----ccccccCCCceEEEEEEecCccceEEEec---CCCceeEEEeccccccccccccccccccCcchhhHHhcc
Confidence 99753 68999999999999999999767899986 4889999998511
Q ss_pred -CCCCceEEEEeecCcEEEEeecccc
Q 000080 2354 -PPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus 2354 -~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
-+...++++..|++.|+++|-|---
T Consensus 317 pL~dg~l~tydehEDSVY~~aWSsad 342 (370)
T KOG1007|consen 317 PLQDGQLETYDEHEDSVYALAWSSAD 342 (370)
T ss_pred cccccccccccccccceEEEeeccCC
Confidence 0122356788899999998866533
No 150
>KOG4328 consensus WD40 protein [Function unknown]
Probab=98.89 E-value=2.6e-08 Score=121.34 Aligned_cols=145 Identities=15% Similarity=0.212 Sum_probs=113.5
Q ss_pred ccccceeeccccccccccccc----cCCCCc--CceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCce-eeEecccCCC
Q 000080 2191 YAGIGASALGWETQDDFEDYV----DPPATV--ENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKA-TATYGVLPAA 2263 (2389)
Q Consensus 2191 ~~~~~Asg~~~d~~~~~~~~~----d~~atv--~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~-l~Tl~vl~gh 2263 (2389)
.+.+--+. +||.+.|+.+|. +.+.+. +++...++.|+.+.+.++.|..=|...+||.+++.. ..-++
T Consensus 246 n~s~i~ss-SyDGtiR~~D~~~~i~e~v~s~~~d~~~fs~~d~~~e~~~vl~~~~~G~f~~iD~R~~~s~~~~~~----- 319 (498)
T KOG4328|consen 246 NTSQIYSS-SYDGTIRLQDFEGNISEEVLSLDTDNIWFSSLDFSAESRSVLFGDNVGNFNVIDLRTDGSEYENLR----- 319 (498)
T ss_pred Chhheeee-ccCceeeeeeecchhhHHHhhcCccceeeeeccccCCCccEEEeecccceEEEEeecCCccchhhh-----
Confidence 44444555 899999999885 445555 456778899999999888888878999999998764 22222
Q ss_pred CCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCC
Q 000080 2264 NVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSN 2342 (2389)
Q Consensus 2264 ~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~ 2342 (2389)
=|...|++|+|+|.- ..|||||.|+|+||||++.-+ ....|+.....|...|.++.|||.+|+ |+|. +.
T Consensus 320 -----lh~kKI~sv~~NP~~p~~laT~s~D~T~kIWD~R~l~-~K~sp~lst~~HrrsV~sAyFSPs~gt-l~TT---~~ 389 (498)
T KOG4328|consen 320 -----LHKKKITSVALNPVCPWFLATASLDQTAKIWDLRQLR-GKASPFLSTLPHRRSVNSAYFSPSGGT-LLTT---CQ 389 (498)
T ss_pred -----hhhcccceeecCCCCchheeecccCcceeeeehhhhc-CCCCcceecccccceeeeeEEcCCCCc-eEee---cc
Confidence 156789999999996 799999999999999998742 111256777789999999999996666 7776 48
Q ss_pred CCeEEEeeC
Q 000080 2343 GINVVVWDT 2351 (2389)
Q Consensus 2343 D~TVrLWD~ 2351 (2389)
|.+|||||.
T Consensus 390 D~~IRv~ds 398 (498)
T KOG4328|consen 390 DNEIRVFDS 398 (498)
T ss_pred CCceEEeec
Confidence 999999996
No 151
>KOG0290 consensus Conserved WD40 repeat-containing protein AN11 [Function unknown]
Probab=98.88 E-value=6.7e-08 Score=112.89 Aligned_cols=255 Identities=14% Similarity=0.195 Sum_probs=152.2
Q ss_pred ccccCCCCCCCCCCC-CCcccccccc-cccCCCCCCCcceeec--CCCCCCeEEEEec-----CCcEEEEeCCCCccccc
Q 000080 7 GCSLQNANPCVDPTE-HLPLAFLRSE-FIPTAPTRSTSTIDWL--PDFAGYSWVAYGA-----SSLLVISHFPSPLSQEE 77 (2389)
Q Consensus 7 ~~~~~~~~~~~~~~~-~lpl~~~~~~-~ip~ap~~~~~ai~wl--pD~~G~~~vAYas-----g~~vVI~~l~SP~~~~e 77 (2389)
+--.|+..++.+|++ .+|....+.+ ++.=---=..-++.|+ ||. . .++|.|+ .-.|=|+.|++- +-|
T Consensus 11 ~i~~q~~~~~~s~i~~~~~~~~~r~~eiy~Y~ap~~lya~~Ws~~~~~-~-~rla~gS~~Ee~~Nkvqiv~ld~~--s~e 86 (364)
T KOG0290|consen 11 HIQDQQGRTYSSPIQRSSPEGNPRRKEIYTYNAPWPLYAMNWSVRPDK-K-FRLAVGSFIEEYNNKVQIVQLDED--SGE 86 (364)
T ss_pred hhhhhhccccCCcccccCcccCcccceEEEecCCCceeeeccccCCCc-c-eeEEEeeeccccCCeeEEEEEccC--CCc
Confidence 334567777888854 3455544443 3322222345688998 663 3 5899884 334555565531 112
Q ss_pred ccccccceeeeeccCCCCCeeEEEEcCCCC-CCCcEEEecCCeEEEEeeCCCCCCCCccceeeEEec------ccceEEE
Q 000080 78 ALIGPIFRQVFALSDNSLPVTSISWSPETP-SIGQLAAASENCIFVFAHDSASSKGSFCWSQNAILV------QGTKVEA 150 (2389)
Q Consensus 78 ~~~~p~~~Qviegh~d~~dVk~VaWSPd~~-~~GeIaASyDntIRVw~~d~~~~kgd~~W~~~~tL~------hssTV~s 150 (2389)
.+.- .. -+|.++|+.+-|.|++- ..-+++|++++..|+|+-..+ +-.-.+...|. +...+.+
T Consensus 87 ~~~~----a~---fd~~YP~tK~~wiPd~~g~~pdlLATs~D~LRlWri~~e----e~~~~~~~~L~~~kns~~~aPlTS 155 (364)
T KOG0290|consen 87 LVED----AN---FDHPYPVTKLMWIPDSKGVYPDLLATSSDFLRLWRIGDE----ESRVELQSVLNNNKNSEFCAPLTS 155 (364)
T ss_pred eecc----CC---CCCCCCccceEecCCccccCcchhhcccCeEEEEeccCc----CCceehhhhhccCcccccCCcccc
Confidence 2200 11 14458999999999721 112688988899999986521 11223333332 3567888
Q ss_pred EeecCCC-CeEEEEecc--eEEeeccCC-cEEEEEEeeccccceEEEEeecCCCc--eEeeecccc---cccC-------
Q 000080 151 IEWTGSG-DGIVAGGME--TVLWKKKNT-LWEIAWKFKENYPQNLVSATWSIEGP--SATAASMSQ---LDLL------- 214 (2389)
Q Consensus 151 IAWSpdG-~rLaSggdD--V~IW~~~~s-~Wecvwt~~~~~~~~ivsvaWSpdG~--fATag~dik---f~~~------- 214 (2389)
..|+--- ++|.++|-| ..||+...+ ....-.++ -.|...+|+++|+..|. |||+|+|.. |...
T Consensus 156 FDWne~dp~~igtSSiDTTCTiWdie~~~~~~vkTQL-IAHDKEV~DIaf~~~s~~~FASvgaDGSvRmFDLR~leHSTI 234 (364)
T KOG0290|consen 156 FDWNEVDPNLIGTSSIDTTCTIWDIETGVSGTVKTQL-IAHDKEVYDIAFLKGSRDVFASVGADGSVRMFDLRSLEHSTI 234 (364)
T ss_pred cccccCCcceeEeecccCeEEEEEEeeccccceeeEE-EecCcceeEEEeccCccceEEEecCCCcEEEEEecccccceE
Confidence 8998644 566688887 679997665 22222222 24667889999999776 999999554 4332
Q ss_pred --CCCCCCceeEEEe---------------------eCCCccce--eecccCCCCeeEEEeccCCCCCCCCCCccccCce
Q 000080 215 --GPKEAGKCVFICC---------------------SDGKSEYI--KLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHV 269 (2389)
Q Consensus 215 --~~~~~~kpV~V~~---------------------~dg~~~~~--~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nI 269 (2389)
+.++.+.|..-.. -|-..... .....|..+||+|+|.|. .++.
T Consensus 235 IYE~p~~~~pLlRLswnkqDpnymATf~~dS~~V~iLDiR~P~tpva~L~~H~a~VNgIaWaPh------------S~~h 302 (364)
T KOG0290|consen 235 IYEDPSPSTPLLRLSWNKQDPNYMATFAMDSNKVVILDIRVPCTPVARLRNHQASVNGIAWAPH------------SSSH 302 (364)
T ss_pred EecCCCCCCcceeeccCcCCchHHhhhhcCCceEEEEEecCCCcceehhhcCcccccceEecCC------------CCce
Confidence 1122122221100 01011100 124789999999999994 2344
Q ss_pred EEeeecCCeEEEEEeecCCc
Q 000080 270 LLTCCLDGTVRLWCEMDSGK 289 (2389)
Q Consensus 270 LAScSdDgTVRLW~e~d~Gk 289 (2389)
|.||+||-.+-||+....++
T Consensus 303 ictaGDD~qaliWDl~q~~~ 322 (364)
T KOG0290|consen 303 ICTAGDDCQALIWDLQQMPR 322 (364)
T ss_pred eeecCCcceEEEEecccccc
Confidence 99999999999999875433
No 152
>KOG0307 consensus Vesicle coat complex COPII, subunit SEC31 [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.87 E-value=5.1e-09 Score=137.17 Aligned_cols=176 Identities=16% Similarity=0.195 Sum_probs=128.1
Q ss_pred ccceeeccccccccccccccC--------CCC--cCceeEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccC
Q 000080 2193 GIGASALGWETQDDFEDYVDP--------PAT--VENISTRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLP 2261 (2389)
Q Consensus 2193 ~~~Asg~~~d~~~~~~~~~d~--------~at--v~ni~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~ 2261 (2389)
|+.|.| +-|..+.+++-... +++ .+...|+.+.|+|.+. +||||++||.|-|||+.+-+.-.++
T Consensus 81 GlIaGG-~edG~I~ly~p~~~~~~~~~~~la~~~~h~G~V~gLDfN~~q~nlLASGa~~geI~iWDlnn~~tP~~~---- 155 (1049)
T KOG0307|consen 81 GLIAGG-LEDGNIVLYDPASIIANASEEVLATKSKHTGPVLGLDFNPFQGNLLASGADDGEILIWDLNKPETPFTP---- 155 (1049)
T ss_pred ceeecc-ccCCceEEecchhhccCcchHHHhhhcccCCceeeeeccccCCceeeccCCCCcEEEeccCCcCCCCCC----
Confidence 455555 55556666654321 122 2346889999999877 9999999999999999875543333
Q ss_pred CCCCCCCCCCCCEEEEEECCC-CCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCC--CeeEEEEecCCCCEEEEee
Q 000080 2262 AANVPPPYALASISALQFDHY-GHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSS--HAMDVSYITSSGSVIAAAG 2338 (2389)
Q Consensus 2262 gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~--~V~sVAFSP~DGslLASAG 2338 (2389)
+ . ....+.|.+|+++-. .+.||||+.+|++-+||++.. +++..+.-|.+ .+..++|+|++.+.|++|.
T Consensus 156 ~-~---~~~~~eI~~lsWNrkvqhILAS~s~sg~~~iWDlr~~-----~pii~ls~~~~~~~~S~l~WhP~~aTql~~As 226 (1049)
T KOG0307|consen 156 G-S---QAPPSEIKCLSWNRKVSHILASGSPSGRAVIWDLRKK-----KPIIKLSDTPGRMHCSVLAWHPDHATQLLVAS 226 (1049)
T ss_pred C-C---CCCcccceEeccchhhhHHhhccCCCCCceeccccCC-----CcccccccCCCccceeeeeeCCCCceeeeeec
Confidence 1 1 112378999999966 589999999999999999863 46655555554 5779999998777787764
Q ss_pred cCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc-hhhhc
Q 000080 2339 HSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL-NFALS 2383 (2389)
Q Consensus 2339 ~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~-~~~~s 2383 (2389)
-+-.+-.|++||+..+ ...++.+++|+-+|.+++-.+.+ +..||
T Consensus 227 ~dd~~PviqlWDlR~a-ssP~k~~~~H~~GilslsWc~~D~~lllS 271 (1049)
T KOG0307|consen 227 GDDSAPVIQLWDLRFA-SSPLKILEGHQRGILSLSWCPQDPRLLLS 271 (1049)
T ss_pred CCCCCceeEeeccccc-CCchhhhcccccceeeeccCCCCchhhhc
Confidence 2223346999998533 34589999999999999999998 55554
No 153
>KOG0642 consensus Cell-cycle nuclear protein, contains WD-40 repeats [Cell cycle control, cell division, chromosome partitioning]
Probab=98.87 E-value=4.2e-09 Score=130.33 Aligned_cols=118 Identities=19% Similarity=0.327 Sum_probs=95.2
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCC------C--ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGK------D--KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD 2292 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~t------G--k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D 2292 (2389)
.||+++|||..+-|++++.|++|++|++.. + +.+.||+ ||.+.|-||+.++.|+.+-||+.|
T Consensus 296 ~ir~l~~~~sep~lit~sed~~lk~WnLqk~~~s~~~~~epi~tfr----------aH~gPVl~v~v~~n~~~~ysgg~D 365 (577)
T KOG0642|consen 296 CIRALAFHPSEPVLITASEDGTLKLWNLQKAKKSAEKDVEPILTFR----------AHEGPVLCVVVPSNGEHCYSGGID 365 (577)
T ss_pred hhhhhhcCCCCCeEEEeccccchhhhhhcccCCccccceeeeEEEe----------cccCceEEEEecCCceEEEeeccC
Confidence 359999999999999999999999999931 1 2356664 578999999999999999999999
Q ss_pred CcEEEeeCCCCCc---cC--cccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080 2293 GTVCTWQLEVGGR---SN--VRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2293 gTVkLWDl~tggr---s~--~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
|+||.|++-.... +. .....++.||...|+.++||+ .-..|++. |.|+|||+|+..
T Consensus 366 g~I~~w~~p~n~dp~ds~dp~vl~~~l~Ghtdavw~l~~s~-~~~~Llsc---s~DgTvr~w~~~ 426 (577)
T KOG0642|consen 366 GTIRCWNLPPNQDPDDSYDPSVLSGTLLGHTDAVWLLALSS-TKDRLLSC---SSDGTVRLWEPT 426 (577)
T ss_pred ceeeeeccCCCCCcccccCcchhccceeccccceeeeeecc-cccceeee---cCCceEEeeccC
Confidence 9999996642110 00 012356899999999999998 66778885 689999999973
No 154
>KOG0321 consensus WD40 repeat-containing protein L2DTL [Function unknown]
Probab=98.86 E-value=8.3e-09 Score=128.82 Aligned_cols=163 Identities=16% Similarity=0.221 Sum_probs=118.1
Q ss_pred cccCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEE
Q 000080 2210 YVDPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFAS 2288 (2389)
Q Consensus 2210 ~~d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LAS 2288 (2389)
|.++.++-+- |-.+.|-|-.-.|++++.|.|||+||+.+++++..- + ..||...|.+++|.|+. ..|++
T Consensus 93 lk~~~aH~nA--ifDl~wapge~~lVsasGDsT~r~Wdvk~s~l~G~~-~-------~~GH~~SvkS~cf~~~n~~vF~t 162 (720)
T KOG0321|consen 93 LKKPLAHKNA--IFDLKWAPGESLLVSASGDSTIRPWDVKTSRLVGGR-L-------NLGHTGSVKSECFMPTNPAVFCT 162 (720)
T ss_pred hcccccccce--eEeeccCCCceeEEEccCCceeeeeeeccceeecce-e-------ecccccccchhhhccCCCcceee
Confidence 4566666543 489999994447999999999999999999887651 1 13788999999999987 79999
Q ss_pred EeCCCcEEEeeCCCCCc-------------cC-----c----ccceeeeecCCCeeE---EEEecCCCCEEEEeecCCCC
Q 000080 2289 AALDGTVCTWQLEVGGR-------------SN-----V----RPMESCLCFSSHAMD---VSYITSSGSVIAAAGHSSNG 2343 (2389)
Q Consensus 2289 gS~DgTVkLWDl~tggr-------------s~-----~----k~l~tl~gHs~~V~s---VAFSP~DGslLASAG~sS~D 2343 (2389)
|+.||.|.|||++..+. -+ . +.+.....|+..+.+ |.|.. |...||||| ..|
T Consensus 163 GgRDg~illWD~R~n~~d~~e~~~~~~~~~~n~~ptpskp~~kr~~k~kA~s~ti~ssvTvv~fk-De~tlaSag--a~D 239 (720)
T KOG0321|consen 163 GGRDGEILLWDCRCNGVDALEEFDNRIYGRHNTAPTPSKPLKKRIRKWKAASNTIFSSVTVVLFK-DESTLASAG--AAD 239 (720)
T ss_pred ccCCCcEEEEEEeccchhhHHHHhhhhhccccCCCCCCchhhccccccccccCceeeeeEEEEEe-ccceeeecc--CCC
Confidence 99999999999975320 00 0 112233456666776 77777 889999987 579
Q ss_pred CeEEEeeCCCCCC----Cc--eEEEEee---cCcEEEEeecccchhhhccc
Q 000080 2344 INVVVWDTLAPPT----SS--RASITCH---EGLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus 2344 ~TVrLWD~l~~tg----~~--v~sL~GH---~~~V~svA~~~~~~~~~s~~ 2385 (2389)
++||+||+..+.. +. +..+..| .-++.++...-.|.+.+-.|
T Consensus 240 ~~iKVWDLRk~~~~~r~ep~~~~~~~t~skrs~G~~nL~lDssGt~L~AsC 290 (720)
T KOG0321|consen 240 STIKVWDLRKNYTAYRQEPRGSDKYPTHSKRSVGQVNLILDSSGTYLFASC 290 (720)
T ss_pred cceEEEeecccccccccCCCcccCccCcccceeeeEEEEecCCCCeEEEEe
Confidence 9999999853211 11 2233334 45677888888888877666
No 155
>KOG0646 consensus WD40 repeat protein [General function prediction only]
Probab=98.85 E-value=1.9e-08 Score=122.76 Aligned_cols=159 Identities=15% Similarity=0.172 Sum_probs=117.8
Q ss_pred ccccccccccccccC-CCCcC-----ceeEEEEEEcCC--CCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCC
Q 000080 2199 LGWETQDDFEDYVDP-PATVE-----NISTRAFSSHPL--RPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYA 2270 (2389)
Q Consensus 2199 ~~~d~~~~~~~~~d~-~atv~-----ni~VrsVAFsPd--G~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH 2270 (2389)
+.|..++-+.+..+. ++.+. ..+|..+-..+- ..+|+|+|.|.|||+||+..|..+.++. + |
T Consensus 148 ~vW~l~~lv~a~~~~~~~p~~~f~~HtlsITDl~ig~Gg~~~rl~TaS~D~t~k~wdlS~g~LLlti~-f-----p---- 217 (476)
T KOG0646|consen 148 LVWLLTDLVSADNDHSVKPLHIFSDHTLSITDLQIGSGGTNARLYTASEDRTIKLWDLSLGVLLLTIT-F-----P---- 217 (476)
T ss_pred EEEEEEeecccccCCCccceeeeccCcceeEEEEecCCCccceEEEecCCceEEEEEeccceeeEEEe-c-----C----
Confidence 456666655555432 11111 135666655554 4589999999999999999999888864 1 1
Q ss_pred CCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCC--c---------cCcccceeeeecCC--CeeEEEEecCCCCEEEEe
Q 000080 2271 LASISALQFDHYGHRFASAALDGTVCTWQLEVGG--R---------SNVRPMESCLCFSS--HAMDVSYITSSGSVIAAA 2337 (2389)
Q Consensus 2271 ~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tgg--r---------s~~k~l~tl~gHs~--~V~sVAFSP~DGslLASA 2337 (2389)
..+.+|+.+|-++.+-.|+.||.|.+-++..-. + .....+..+.||.+ .|++++++- ||++|+||
T Consensus 218 -~si~av~lDpae~~~yiGt~~G~I~~~~~~~~~~~~~~v~~k~~~~~~t~~~~~~Gh~~~~~ITcLais~-DgtlLlSG 295 (476)
T KOG0646|consen 218 -SSIKAVALDPAERVVYIGTEEGKIFQNLLFKLSGQSAGVNQKGRHEENTQINVLVGHENESAITCLAIST-DGTLLLSG 295 (476)
T ss_pred -CcceeEEEcccccEEEecCCcceEEeeehhcCCcccccccccccccccceeeeeccccCCcceeEEEEec-CccEEEee
Confidence 558999999999999999999988877665421 0 01134566889998 999999999 99999996
Q ss_pred ecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080 2338 GHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus 2338 G~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
+.|++|+|||+ ...+|+++++--.+.|+-+..
T Consensus 296 ---d~dg~VcvWdi--~S~Q~iRtl~~~kgpVtnL~i 327 (476)
T KOG0646|consen 296 ---DEDGKVCVWDI--YSKQCIRTLQTSKGPVTNLQI 327 (476)
T ss_pred ---CCCCCEEEEec--chHHHHHHHhhhccccceeEe
Confidence 59999999998 466788888766677776665
No 156
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=98.85 E-value=2.5e-08 Score=117.25 Aligned_cols=110 Identities=18% Similarity=0.258 Sum_probs=93.4
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.|.+|.|+|.+..|+.+|+||++|++|+....+...|+ |...+.+.+|-++ ..+++|+.||.||+.|+
T Consensus 15 ~IS~v~f~~~~~~LLvssWDgslrlYdv~~~~l~~~~~-----------~~~plL~c~F~d~-~~~~~G~~dg~vr~~Dl 82 (323)
T KOG1036|consen 15 GISSVKFSPSSSDLLVSSWDGSLRLYDVPANSLKLKFK-----------HGAPLLDCAFADE-STIVTGGLDGQVRRYDL 82 (323)
T ss_pred ceeeEEEcCcCCcEEEEeccCcEEEEeccchhhhhhee-----------cCCceeeeeccCC-ceEEEeccCceEEEEEe
Confidence 46999999999999999999999999998776666664 4577999999985 68999999999999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
+++ +...+.-|...|++|.+++..|.+| || |.|++|++||+.
T Consensus 83 n~~------~~~~igth~~~i~ci~~~~~~~~vI-sg---sWD~~ik~wD~R 124 (323)
T KOG1036|consen 83 NTG------NEDQIGTHDEGIRCIEYSYEVGCVI-SG---SWDKTIKFWDPR 124 (323)
T ss_pred cCC------cceeeccCCCceEEEEeeccCCeEE-Ec---ccCccEEEEecc
Confidence 986 2345567999999999998666666 44 599999999984
No 157
>KOG4283 consensus Transcription-coupled repair protein CSA, contains WD40 domain [Transcription; Replication, recombination and repair]
Probab=98.84 E-value=1.2e-08 Score=118.82 Aligned_cols=147 Identities=12% Similarity=0.232 Sum_probs=116.9
Q ss_pred ccccccceeeccccccccccccccCCCCcC----ceeEEEEEEcCCCC---eEEEEeCCCcEEEeecCCCceeeEecccC
Q 000080 2189 PGYAGIGASALGWETQDDFEDYVDPPATVE----NISTRAFSSHPLRP---FFLVGSSNTHIYLWEFGKDKATATYGVLP 2261 (2389)
Q Consensus 2189 ~g~~~~~Asg~~~d~~~~~~~~~d~~atv~----ni~VrsVAFsPdG~---~LASGS~DgTIRLWDl~tGk~l~Tl~vl~ 2261 (2389)
|=.+||-.++ +.|.+-++|+.... .+.. .-.|.+-+++|-.- +||+|-.|-.|||-|+.+|.+..++.
T Consensus 111 P~DtGmFtss-SFDhtlKVWDtnTl-Q~a~~F~me~~VYshamSp~a~sHcLiA~gtr~~~VrLCDi~SGs~sH~Ls--- 185 (397)
T KOG4283|consen 111 PIDTGMFTSS-SFDHTLKVWDTNTL-QEAVDFKMEGKVYSHAMSPMAMSHCLIAAGTRDVQVRLCDIASGSFSHTLS--- 185 (397)
T ss_pred eecCceeecc-cccceEEEeecccc-eeeEEeecCceeehhhcChhhhcceEEEEecCCCcEEEEeccCCcceeeec---
Confidence 6678888999 99999999987422 1111 02457778888543 89999999999999999999999984
Q ss_pred CCCCCCCCCCCCEEEEEECCCCC-EEEEEeCCCcEEEeeCCCC-Cc------c---CcccceeeeecCCCeeEEEEecCC
Q 000080 2262 AANVPPPYALASISALQFDHYGH-RFASAALDGTVCTWQLEVG-GR------S---NVRPMESCLCFSSHAMDVSYITSS 2330 (2389)
Q Consensus 2262 gh~~p~~GH~~~V~sVaFSPDG~-~LASgS~DgTVkLWDl~tg-gr------s---~~k~l~tl~gHs~~V~sVAFSP~D 2330 (2389)
||.+.|.+|.+||... .||+||.||+|||||++.. +. . .+..+++-..|.+.|+++||.. |
T Consensus 186 -------GHr~~vlaV~Wsp~~e~vLatgsaDg~irlWDiRrasgcf~~lD~hn~k~~p~~~~n~ah~gkvngla~tS-d 257 (397)
T KOG4283|consen 186 -------GHRDGVLAVEWSPSSEWVLATGSADGAIRLWDIRRASGCFRVLDQHNTKRPPILKTNTAHYGKVNGLAWTS-D 257 (397)
T ss_pred -------cccCceEEEEeccCceeEEEecCCCceEEEEEeecccceeEEeecccCccCccccccccccceeeeeeecc-c
Confidence 6789999999999975 7899999999999999864 10 0 1122344567889999999999 9
Q ss_pred CCEEEEeecCCCCCeEEEeeC
Q 000080 2331 GSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2331 GslLASAG~sS~D~TVrLWD~ 2351 (2389)
|..+++.| .|.-+|+|+.
T Consensus 258 ~~~l~~~g---td~r~r~wn~ 275 (397)
T KOG4283|consen 258 ARYLASCG---TDDRIRVWNM 275 (397)
T ss_pred chhhhhcc---CccceEEeec
Confidence 99999976 6778999997
No 158
>KOG1009 consensus Chromatin assembly complex 1 subunit B/CAC2 (contains WD40 repeats) [Chromatin structure and dynamics; Replication, recombination and repair]
Probab=98.83 E-value=4e-08 Score=118.55 Aligned_cols=156 Identities=16% Similarity=0.271 Sum_probs=110.2
Q ss_pred CCeeEEEEcCCCCCCC-cEEE-ecCCeEEEEeeCC-CCCCCCccceeeEEec-ccceEEEEeecCCCCeEEEEecc--eE
Q 000080 95 LPVTSISWSPETPSIG-QLAA-ASENCIFVFAHDS-ASSKGSFCWSQNAILV-QGTKVEAIEWTGSGDGIVAGGME--TV 168 (2389)
Q Consensus 95 ~dVk~VaWSPd~~~~G-eIaA-SyDntIRVw~~d~-~~~kgd~~W~~~~tL~-hssTV~sIAWSpdG~rLaSggdD--V~ 168 (2389)
.+|-.|.+++. .+ .+|. +.|+.||+|.... ...+++-.=.-.++|. |+..|..|.|+|+|+.||||||+ +.
T Consensus 14 ~pv~s~dfq~n---~~~~laT~G~D~~iriW~v~r~~~~~~~~~V~y~s~Ls~H~~aVN~vRf~p~gelLASg~D~g~v~ 90 (434)
T KOG1009|consen 14 EPVYSVDFQKN---SLNKLATAGGDKDIRIWKVNRSEPGGGDMKVEYLSSLSRHTRAVNVVRFSPDGELLASGGDGGEVF 90 (434)
T ss_pred CceEEEEeccC---cccceecccCccceeeeeeeecCCCCCceeEEEeecccCCcceeEEEEEcCCcCeeeecCCCceEE
Confidence 69999999995 33 5663 4689999998762 2223321222244554 89999999999999999999998 88
Q ss_pred Eeecc--------------CCcEEEEEEeeccccceEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCcc
Q 000080 169 LWKKK--------------NTLWEIAWKFKENYPQNLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSE 233 (2389)
Q Consensus 169 IW~~~--------------~s~Wecvwt~~~~~~~~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~ 233 (2389)
+|+.. ...|...=.+.+ |...+|+.+|+||+. +++++.|. .+..|.. ....
T Consensus 91 lWk~~~~~~~~~d~e~~~~ke~w~v~k~lr~-h~~diydL~Ws~d~~~l~s~s~dn------------s~~l~Dv-~~G~ 156 (434)
T KOG1009|consen 91 LWKQGDVRIFDADTEADLNKEKWVVKKVLRG-HRDDIYDLAWSPDSNFLVSGSVDN------------SVRLWDV-HAGQ 156 (434)
T ss_pred EEEecCcCCccccchhhhCccceEEEEEecc-cccchhhhhccCCCceeeeeeccc------------eEEEEEe-ccce
Confidence 99965 344664322343 667899999999999 88888873 3444432 2333
Q ss_pred ceeecccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEE
Q 000080 234 YIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVR 280 (2389)
Q Consensus 234 ~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVR 280 (2389)
.......|...|++|+|-|- .++ ++|=|-|.-.+
T Consensus 157 l~~~~~dh~~yvqgvawDpl--------~qy-----v~s~s~dr~~~ 190 (434)
T KOG1009|consen 157 LLAILDDHEHYVQGVAWDPL--------NQY-----VASKSSDRHPE 190 (434)
T ss_pred eEeeccccccccceeecchh--------hhh-----hhhhccCcccc
Confidence 56677899999999999993 233 56666776333
No 159
>KOG2394 consensus WD40 protein DMR-N9 [General function prediction only]
Probab=98.82 E-value=8.5e-09 Score=126.88 Aligned_cols=92 Identities=14% Similarity=0.238 Sum_probs=79.3
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.|...+|+|||++||+-|+||.+||+|+.+-+++..++.. -+...+|++||||+++|+|++|.-|.+|.+
T Consensus 292 ~in~f~FS~DG~~LA~VSqDGfLRvF~fdt~eLlg~mkSY----------FGGLLCvcWSPDGKyIvtGGEDDLVtVwSf 361 (636)
T KOG2394|consen 292 SINEFAFSPDGKYLATVSQDGFLRIFDFDTQELLGVMKSY----------FGGLLCVCWSPDGKYIVTGGEDDLVTVWSF 361 (636)
T ss_pred cccceeEcCCCceEEEEecCceEEEeeccHHHHHHHHHhh----------ccceEEEEEcCCccEEEecCCcceEEEEEe
Confidence 4466799999999999999999999999877766544321 155899999999999999999999999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEe
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYI 2327 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFS 2327 (2389)
... +.+..-+||..+|+.|||.
T Consensus 362 ~er-----RVVARGqGHkSWVs~VaFD 383 (636)
T KOG2394|consen 362 EER-----RVVARGQGHKSWVSVVAFD 383 (636)
T ss_pred ccc-----eEEEeccccccceeeEeec
Confidence 864 5677789999999999998
No 160
>KOG0268 consensus Sof1-like rRNA processing protein (contains WD40 repeats) [RNA processing and modification]
Probab=98.82 E-value=7.3e-09 Score=123.22 Aligned_cols=114 Identities=18% Similarity=0.297 Sum_probs=91.2
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc-eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK-ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk-~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
.+.+|+|+|.+-.+++|++|..++.+|++.=+ .+..+ .+|.+.|.+|.|||-|+-|+|||-|.||||+.
T Consensus 231 RTN~IswnPeafnF~~a~ED~nlY~~DmR~l~~p~~v~----------~dhvsAV~dVdfsptG~EfvsgsyDksIRIf~ 300 (433)
T KOG0268|consen 231 RTNTICWNPEAFNFVAANEDHNLYTYDMRNLSRPLNVH----------KDHVSAVMDVDFSPTGQEFVSGSYDKSIRIFP 300 (433)
T ss_pred cccceecCccccceeeccccccceehhhhhhcccchhh----------cccceeEEEeccCCCcchhccccccceEEEee
Confidence 55678999999999999999999999996432 22322 26779999999999999999999999999999
Q ss_pred CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
++.+. | +.++- .---..|.+|.||- |.++|.|| |+|++||||...
T Consensus 301 ~~~~~-S--RdiYh-tkRMq~V~~Vk~S~-Dskyi~SG---Sdd~nvRlWka~ 345 (433)
T KOG0268|consen 301 VNHGH-S--RDIYH-TKRMQHVFCVKYSM-DSKYIISG---SDDGNVRLWKAK 345 (433)
T ss_pred cCCCc-c--hhhhh-HhhhheeeEEEEec-cccEEEec---CCCcceeeeecc
Confidence 99762 2 22210 00114788999999 88999985 799999999963
No 161
>KOG1523 consensus Actin-related protein Arp2/3 complex, subunit ARPC1/p41-ARC [Cytoskeleton]
Probab=98.81 E-value=5.2e-08 Score=115.05 Aligned_cols=155 Identities=16% Similarity=0.420 Sum_probs=126.2
Q ss_pred CeeEEEEcCCCCCCCcEEEec-CCeEEEEeeCCCCCCCCccceeeEEec-ccceEEEEeecCCCCeEEEEecc--eEEee
Q 000080 96 PVTSISWSPETPSIGQLAAAS-ENCIFVFAHDSASSKGSFCWSQNAILV-QGTKVEAIEWTGSGDGIVAGGME--TVLWK 171 (2389)
Q Consensus 96 dVk~VaWSPd~~~~GeIaASy-DntIRVw~~d~~~~kgd~~W~~~~tL~-hssTV~sIAWSpdG~rLaSggdD--V~IW~ 171 (2389)
+++|-||++| ...||.+. .+-|-||+-. +..-|....+|. |...|..|.|+|.++||++|+-| --+|.
T Consensus 12 pitchAwn~d---rt~iAv~~~~~evhiy~~~-----~~~~w~~~htls~Hd~~vtgvdWap~snrIvtcs~drnayVw~ 83 (361)
T KOG1523|consen 12 PITCHAWNSD---RTQIAVSPNNHEVHIYSML-----GADLWEPAHTLSEHDKIVTGVDWAPKSNRIVTCSHDRNAYVWT 83 (361)
T ss_pred ceeeeeecCC---CceEEeccCCceEEEEEec-----CCCCceeceehhhhCcceeEEeecCCCCceeEccCCCCccccc
Confidence 8999999999 77788775 4689999987 232499999996 89999999999999999999998 77999
Q ss_pred c-cCCcEEEEEEeeccccceEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCcccee---ecccCCCCee
Q 000080 172 K-KNTLWEIAWKFKENYPQNLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIK---LELCHPQPVS 246 (2389)
Q Consensus 172 ~-~~s~Wecvwt~~~~~~~~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~---ve~aH~qdVn 246 (2389)
. ..++|+-.--+ ..+.+-.-+|.|||.+. ||++++... +-|||+.++..... +...|-..|.
T Consensus 84 ~~~~~~WkptlvL-lRiNrAAt~V~WsP~enkFAVgSgar~------------isVcy~E~ENdWWVsKhikkPirStv~ 150 (361)
T KOG1523|consen 84 QPSGGTWKPTLVL-LRINRAATCVKWSPKENKFAVGSGARL------------ISVCYYEQENDWWVSKHIKKPIRSTVT 150 (361)
T ss_pred cCCCCeeccceeE-EEeccceeeEeecCcCceEEeccCccE------------EEEEEEecccceehhhhhCCcccccee
Confidence 7 78899876544 35667777899999877 999999633 45777766665533 4577889999
Q ss_pred EEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEe
Q 000080 247 MVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCE 284 (2389)
Q Consensus 247 ~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e 284 (2389)
++.|+| ..=+||.+|-|+-+|+..-
T Consensus 151 sldWhp-------------nnVLlaaGs~D~k~rVfSa 175 (361)
T KOG1523|consen 151 SLDWHP-------------NNVLLAAGSTDGKCRVFSA 175 (361)
T ss_pred eeeccC-------------CcceecccccCcceeEEEE
Confidence 999999 3446899999999999973
No 162
>KOG0268 consensus Sof1-like rRNA processing protein (contains WD40 repeats) [RNA processing and modification]
Probab=98.80 E-value=7.2e-09 Score=123.27 Aligned_cols=162 Identities=14% Similarity=0.132 Sum_probs=123.1
Q ss_pred ccccccccc--cCCCCcCc--eeEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEE
Q 000080 2203 TQDDFEDYV--DPPATVEN--ISTRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISAL 2277 (2389)
Q Consensus 2203 ~~~~~~~~~--d~~atv~n--i~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sV 2277 (2389)
+...+|+.. .|+.+... -.|.+|.|+|.-. +|++++.|++|.|+|.++++.++.... .-.-..|
T Consensus 167 e~i~IWD~~R~~Pv~smswG~Dti~svkfNpvETsILas~~sDrsIvLyD~R~~~Pl~KVi~-----------~mRTN~I 235 (433)
T KOG0268|consen 167 EQIDIWDEQRDNPVSSMSWGADSISSVKFNPVETSILASCASDRSIVLYDLRQASPLKKVIL-----------TMRTNTI 235 (433)
T ss_pred ceeeecccccCCccceeecCCCceeEEecCCCcchheeeeccCCceEEEecccCCccceeee-----------eccccce
Confidence 445556553 44444332 2458999999866 788888999999999999988765421 1234789
Q ss_pred EECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCC
Q 000080 2278 QFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTS 2357 (2389)
Q Consensus 2278 aFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~ 2357 (2389)
+|+|.+--|.+|++|..+.+.|++.- .+|+..+.+|...|.+|+||| .|+-++|| |-|++|||+.+...+..
T Consensus 236 swnPeafnF~~a~ED~nlY~~DmR~l----~~p~~v~~dhvsAV~dVdfsp-tG~Efvsg---syDksIRIf~~~~~~SR 307 (433)
T KOG0268|consen 236 CWNPEAFNFVAANEDHNLYTYDMRNL----SRPLNVHKDHVSAVMDVDFSP-TGQEFVSG---SYDKSIRIFPVNHGHSR 307 (433)
T ss_pred ecCccccceeeccccccceehhhhhh----cccchhhcccceeEEEeccCC-Ccchhccc---cccceEEEeecCCCcch
Confidence 99999999999999999999999864 278889999999999999999 99999996 68999999998543333
Q ss_pred ceEEEEeecCcEEEEeecccchhhhcc
Q 000080 2358 SRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2358 ~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
.+.- .--...|.||..|-|-.|++|-
T Consensus 308 diYh-tkRMq~V~~Vk~S~Dskyi~SG 333 (433)
T KOG0268|consen 308 DIYH-TKRMQHVFCVKYSMDSKYIISG 333 (433)
T ss_pred hhhh-HhhhheeeEEEEeccccEEEec
Confidence 2210 0012347788888888888774
No 163
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=98.80 E-value=3.9e-08 Score=115.76 Aligned_cols=183 Identities=11% Similarity=0.117 Sum_probs=134.7
Q ss_pred CCccccCccccccccccccceeeccccccccccccccCCCCcC---ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc
Q 000080 2176 PGRDLTGGLAFGIPGYAGIGASALGWETQDDFEDYVDPPATVE---NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK 2252 (2389)
Q Consensus 2176 ~~~~~~~~~~~~~~g~~~~~Asg~~~d~~~~~~~~~d~~atv~---ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk 2252 (2389)
||++..--.-|+ +-...++|+- ||..-++-++......+. .-++-..+|.+ -..+++|+.||.||+.|+.++.
T Consensus 11 pP~d~IS~v~f~-~~~~~LLvss--WDgslrlYdv~~~~l~~~~~~~~plL~c~F~d-~~~~~~G~~dg~vr~~Dln~~~ 86 (323)
T KOG1036|consen 11 PPEDGISSVKFS-PSSSDLLVSS--WDGSLRLYDVPANSLKLKFKHGAPLLDCAFAD-ESTIVTGGLDGQVRRYDLNTGN 86 (323)
T ss_pred CChhceeeEEEc-CcCCcEEEEe--ccCcEEEEeccchhhhhheecCCceeeeeccC-CceEEEeccCceEEEEEecCCc
Confidence 444443334566 6666677765 999999887742222211 24678899999 4568889999999999998887
Q ss_pred eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCC---------Cc------------------
Q 000080 2253 ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVG---------GR------------------ 2305 (2389)
Q Consensus 2253 ~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tg---------gr------------------ 2305 (2389)
..... -|...|++|.+++--..+.|||+|++|++||.+.. ++
T Consensus 87 ~~~ig-----------th~~~i~ci~~~~~~~~vIsgsWD~~ik~wD~R~~~~~~~~d~~kkVy~~~v~g~~LvVg~~~r 155 (323)
T KOG1036|consen 87 EDQIG-----------THDEGIRCIEYSYEVGCVISGSWDKTIKFWDPRNKVVVGTFDQGKKVYCMDVSGNRLVVGTSDR 155 (323)
T ss_pred ceeec-----------cCCCceEEEEeeccCCeEEEcccCccEEEEeccccccccccccCceEEEEeccCCEEEEeecCc
Confidence 54432 25688999999999999999999999999999831 00
Q ss_pred -----------------------------------------------------c--CcccceeeeecC---------CCe
Q 000080 2306 -----------------------------------------------------S--NVRPMESCLCFS---------SHA 2321 (2389)
Q Consensus 2306 -----------------------------------------------------s--~~k~l~tl~gHs---------~~V 2321 (2389)
+ ....-+.+.||. .+|
T Consensus 156 ~v~iyDLRn~~~~~q~reS~lkyqtR~v~~~pn~eGy~~sSieGRVavE~~d~s~~~~skkyaFkCHr~~~~~~~~~yPV 235 (323)
T KOG1036|consen 156 KVLIYDLRNLDEPFQRRESSLKYQTRCVALVPNGEGYVVSSIEGRVAVEYFDDSEEAQSKKYAFKCHRLSEKDTEIIYPV 235 (323)
T ss_pred eEEEEEcccccchhhhccccceeEEEEEEEecCCCceEEEeecceEEEEccCCchHHhhhceeEEeeecccCCceEEEEe
Confidence 0 001123345554 478
Q ss_pred eEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccch
Q 000080 2322 MDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus 2322 ~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~ 2379 (2389)
++++|+| --..+|||| .||-|-+||. .+.+.+..|..-++.|.++|++-+|-
T Consensus 236 Nai~Fhp-~~~tfaTgG---sDG~V~~Wd~--~~rKrl~q~~~~~~SI~slsfs~dG~ 287 (323)
T KOG1036|consen 236 NAIAFHP-IHGTFATGG---SDGIVNIWDL--FNRKRLKQLAKYETSISSLSFSMDGS 287 (323)
T ss_pred ceeEecc-ccceEEecC---CCceEEEccC--cchhhhhhccCCCCceEEEEeccCCC
Confidence 9999999 457799986 8999999998 46677888888888899999998884
No 164
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=98.80 E-value=5e-08 Score=111.81 Aligned_cols=152 Identities=14% Similarity=0.178 Sum_probs=105.5
Q ss_pred eeeccccccc------cccccccCCCC--cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCC
Q 000080 2196 ASALGWETQD------DFEDYVDPPAT--VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPP 2267 (2389)
Q Consensus 2196 Asg~~~d~~~------~~~~~~d~~at--v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~ 2267 (2389)
..|.-|++-+ ++|+...|-++ ++-..|.++...|..+-|+.++.|+.++.||+++|+..++|+
T Consensus 83 V~gw~W~E~~es~~~K~lwe~~~P~~~~~~evPeINam~ldP~enSi~~AgGD~~~y~~dlE~G~i~r~~r--------- 153 (325)
T KOG0649|consen 83 VYGWEWNEEEESLATKRLWEVKIPMQVDAVEVPEINAMWLDPSENSILFAGGDGVIYQVDLEDGRIQREYR--------- 153 (325)
T ss_pred EEEeeehhhhhhccchhhhhhcCccccCcccCCccceeEeccCCCcEEEecCCeEEEEEEecCCEEEEEEc---------
Confidence 4455565544 46665444333 233466999999988877788899999999999999999996
Q ss_pred CCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceee------eec-CCCeeEEEEecCCCCEEEEeecC
Q 000080 2268 PYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESC------LCF-SSHAMDVSYITSSGSVIAAAGHS 2340 (2389)
Q Consensus 2268 ~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl------~gH-s~~V~sVAFSP~DGslLASAG~s 2340 (2389)
||+++|.+|+--.-.-.+.||++|||||+||++|+. +.+.+... +.| ..+|-+++-+. .+|++|
T Consensus 154 -GHtDYvH~vv~R~~~~qilsG~EDGtvRvWd~kt~k--~v~~ie~yk~~~~lRp~~g~wigala~~e---dWlvCG--- 224 (325)
T KOG0649|consen 154 -GHTDYVHSVVGRNANGQILSGAEDGTVRVWDTKTQK--HVSMIEPYKNPNLLRPDWGKWIGALAVNE---DWLVCG--- 224 (325)
T ss_pred -CCcceeeeeeecccCcceeecCCCccEEEEeccccc--eeEEeccccChhhcCcccCceeEEEeccC---ceEEec---
Confidence 688999999994444468899999999999999973 22222211 112 24555666554 789886
Q ss_pred CCCCeEEEeeCCCCCCCceEEEEeec
Q 000080 2341 SNGINVVVWDTLAPPTSSRASITCHE 2366 (2389)
Q Consensus 2341 S~D~TVrLWD~l~~tg~~v~sL~GH~ 2366 (2389)
.+...-||.+...+..|+-.+.+|.
T Consensus 225 -gGp~lslwhLrsse~t~vfpipa~v 249 (325)
T KOG0649|consen 225 -GGPKLSLWHLRSSESTCVFPIPARV 249 (325)
T ss_pred -CCCceeEEeccCCCceEEEecccce
Confidence 4678999998544434444445443
No 165
>PRK01742 tolB translocation protein TolB; Provisional
Probab=98.79 E-value=2.8e-08 Score=123.62 Aligned_cols=139 Identities=12% Similarity=0.032 Sum_probs=98.1
Q ss_pred eEEEEEEcCCCCeEEEEeCC---CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe-CCCcEE
Q 000080 2221 STRAFSSHPLRPFFLVGSSN---THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA-LDGTVC 2296 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~D---gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-~DgTVk 2296 (2389)
.+.+.+|||||+.||.+|.+ .+|++||+.+|+.... ..++ || ..+++|||||++||.++ .||.++
T Consensus 205 ~v~~p~wSPDG~~la~~s~~~~~~~i~i~dl~tg~~~~l-~~~~-------g~---~~~~~wSPDG~~La~~~~~~g~~~ 273 (429)
T PRK01742 205 PLMSPAWSPDGSKLAYVSFENKKSQLVVHDLRSGARKVV-ASFR-------GH---NGAPAFSPDGSRLAFASSKDGVLN 273 (429)
T ss_pred ccccceEcCCCCEEEEEEecCCCcEEEEEeCCCCceEEE-ecCC-------Cc---cCceeECCCCCEEEEEEecCCcEE
Confidence 45788999999999998754 4799999988864322 1112 22 34689999999999875 688877
Q ss_pred Ee--eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080 2297 TW--QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus 2297 LW--Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
|| |+.++ ....+..|...+.+.+|+| ||+.|+.++ ..++.++||++... +.....+ +|.+ .+.++
T Consensus 274 Iy~~d~~~~------~~~~lt~~~~~~~~~~wSp-DG~~i~f~s--~~~g~~~I~~~~~~-~~~~~~l-~~~~--~~~~~ 340 (429)
T PRK01742 274 IYVMGANGG------TPSQLTSGAGNNTEPSWSP-DGQSILFTS--DRSGSPQVYRMSAS-GGGASLV-GGRG--YSAQI 340 (429)
T ss_pred EEEEECCCC------CeEeeccCCCCcCCEEECC-CCCEEEEEE--CCCCCceEEEEECC-CCCeEEe-cCCC--CCccC
Confidence 76 55543 2345566777788999999 999888753 46788999997422 2333333 4544 46788
Q ss_pred cccchhhhc
Q 000080 2375 LKLLNFALS 2383 (2389)
Q Consensus 2375 ~~~~~~~~s 2383 (2389)
+|+|++++.
T Consensus 341 SpDG~~ia~ 349 (429)
T PRK01742 341 SADGKTLVM 349 (429)
T ss_pred CCCCCEEEE
Confidence 999988653
No 166
>KOG0644 consensus Uncharacterized conserved protein, contains WD40 repeat and BROMO domains [General function prediction only]
Probab=98.79 E-value=2.7e-09 Score=135.23 Aligned_cols=109 Identities=16% Similarity=0.291 Sum_probs=99.1
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.|.++.|...|.++++||+|..||+|-..++.|+.+.+ ||.+.++.++-+...-++|++|.|..||+|-+
T Consensus 192 aVyca~fDrtg~~Iitgsdd~lvKiwS~et~~~lAs~r----------Ghs~ditdlavs~~n~~iaaaS~D~vIrvWrl 261 (1113)
T KOG0644|consen 192 AVYCAIFDRTGRYIITGSDDRLVKIWSMETARCLASCR----------GHSGDITDLAVSSNNTMIAAASNDKVIRVWRL 261 (1113)
T ss_pred heeeeeeccccceEeecCccceeeeeeccchhhhccCC----------CCccccchhccchhhhhhhhcccCceEEEEec
Confidence 35899999999999999999999999999999998874 68899999999999999999999999999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
.++ .|+.-++||++.|++++|+| .+++ ++|+|+++||..
T Consensus 262 ~~~-----~pvsvLrghtgavtaiafsP-----~~ss---s~dgt~~~wd~r 300 (1113)
T KOG0644|consen 262 PDG-----APVSVLRGHTGAVTAIAFSP-----RASS---SDDGTCRIWDAR 300 (1113)
T ss_pred CCC-----chHHHHhccccceeeeccCc-----cccC---CCCCceEecccc
Confidence 987 47888999999999999999 3343 699999999973
No 167
>KOG1273 consensus WD40 repeat protein [General function prediction only]
Probab=98.76 E-value=7.3e-08 Score=113.41 Aligned_cols=155 Identities=14% Similarity=0.210 Sum_probs=112.5
Q ss_pred CCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCc
Q 000080 2215 ATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGT 2294 (2389)
Q Consensus 2215 atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgT 2294 (2389)
.|+++....++.|++.|.+||.|-.||.|-|||+.|-..-+++ .+|...|+++++|+||++|.|+|.|..
T Consensus 19 ~tld~~~a~~~~Fs~~G~~lAvGc~nG~vvI~D~~T~~iar~l----------saH~~pi~sl~WS~dgr~LltsS~D~s 88 (405)
T KOG1273|consen 19 HTLDNPLAECCQFSRWGDYLAVGCANGRVVIYDFDTFRIARML----------SAHVRPITSLCWSRDGRKLLTSSRDWS 88 (405)
T ss_pred eeccCCccceEEeccCcceeeeeccCCcEEEEEccccchhhhh----------hccccceeEEEecCCCCEeeeecCCce
Confidence 3455555678899999999999999999999999866644444 257788999999999999999999999
Q ss_pred EEEeeCCCCCcc----CcccceeeeecCCC-------------------------------------eeEEEEecCCCCE
Q 000080 2295 VCTWQLEVGGRS----NVRPMESCLCFSSH-------------------------------------AMDVSYITSSGSV 2333 (2389)
Q Consensus 2295 VkLWDl~tggrs----~~k~l~tl~gHs~~-------------------------------------V~sVAFSP~DGsl 2333 (2389)
|++||+..|..- -..|+...+-|... .....|.+ .|++
T Consensus 89 i~lwDl~~gs~l~rirf~spv~~~q~hp~k~n~~va~~~~~sp~vi~~s~~~h~~Lp~d~d~dln~sas~~~fdr-~g~y 167 (405)
T KOG1273|consen 89 IKLWDLLKGSPLKRIRFDSPVWGAQWHPRKRNKCVATIMEESPVVIDFSDPKHSVLPKDDDGDLNSSASHGVFDR-RGKY 167 (405)
T ss_pred eEEEeccCCCceeEEEccCccceeeeccccCCeEEEEEecCCcEEEEecCCceeeccCCCccccccccccccccC-CCCE
Confidence 999999887310 00011111111110 01122555 6888
Q ss_pred EEEeecCCCCCeEEEeeCCCCCCCceEEEEeec-CcEEEEeecccchhhhccc
Q 000080 2334 IAAAGHSSNGINVVVWDTLAPPTSSRASITCHE-GLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus 2334 LASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~-~~V~svA~~~~~~~~~s~~ 2385 (2389)
|.+| ..-|.+-+.|. .+-+|++++.--+ ..|..+-++-.|+|.+-.|
T Consensus 168 IitG---tsKGkllv~~a--~t~e~vas~rits~~~IK~I~~s~~g~~liiNt 215 (405)
T KOG1273|consen 168 IITG---TSKGKLLVYDA--ETLECVASFRITSVQAIKQIIVSRKGRFLIINT 215 (405)
T ss_pred EEEe---cCcceEEEEec--chheeeeeeeechheeeeEEEEeccCcEEEEec
Confidence 8874 46778888886 5668888886555 7788899999999887655
No 168
>PRK05137 tolB translocation protein TolB; Provisional
Probab=98.71 E-value=1.8e-07 Score=116.54 Aligned_cols=141 Identities=18% Similarity=0.130 Sum_probs=101.2
Q ss_pred eEEEEEEcCCCCeEEEEeC---CCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEE-EEeCCCc--
Q 000080 2221 STRAFSSHPLRPFFLVGSS---NTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFA-SAALDGT-- 2294 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~---DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LA-SgS~DgT-- 2294 (2389)
.+.+.+|+|||+.|+..+. +.+|++||+.+|+... +. . +.+.+.+.+|||||+.|| +.+.|+.
T Consensus 203 ~v~~p~wSpDG~~lay~s~~~g~~~i~~~dl~~g~~~~-l~---~-------~~g~~~~~~~SPDG~~la~~~~~~g~~~ 271 (435)
T PRK05137 203 LVLTPRFSPNRQEITYMSYANGRPRVYLLDLETGQREL-VG---N-------FPGMTFAPRFSPDGRKVVMSLSQGGNTD 271 (435)
T ss_pred CeEeeEECCCCCEEEEEEecCCCCEEEEEECCCCcEEE-ee---c-------CCCcccCcEECCCCCEEEEEEecCCCce
Confidence 4588899999999988774 5789999998887532 21 1 124567889999999876 5566666
Q ss_pred EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080 2295 VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus 2295 VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
|.+||++++. ...+..|.....+.+|+| ||+.||.++....+..|.+||+ .+..++.+..+.+.+...+.
T Consensus 272 Iy~~d~~~~~------~~~Lt~~~~~~~~~~~sp-DG~~i~f~s~~~g~~~Iy~~d~---~g~~~~~lt~~~~~~~~~~~ 341 (435)
T PRK05137 272 IYTMDLRSGT------TTRLTDSPAIDTSPSYSP-DGSQIVFESDRSGSPQLYVMNA---DGSNPRRISFGGGRYSTPVW 341 (435)
T ss_pred EEEEECCCCc------eEEccCCCCccCceeEcC-CCCEEEEEECCCCCCeEEEEEC---CCCCeEEeecCCCcccCeEE
Confidence 6666887652 344555666677899999 9999987631112235777775 34556677666677778889
Q ss_pred cccchhhh
Q 000080 2375 LKLLNFAL 2382 (2389)
Q Consensus 2375 ~~~~~~~~ 2382 (2389)
+|+|++++
T Consensus 342 SpdG~~ia 349 (435)
T PRK05137 342 SPRGDLIA 349 (435)
T ss_pred CCCCCEEE
Confidence 99999875
No 169
>KOG0650 consensus WD40 repeat nucleolar protein Bop1, involved in ribosome biogenesis [Translation, ribosomal structure and biogenesis]
Probab=98.71 E-value=1.6e-07 Score=116.94 Aligned_cols=144 Identities=15% Similarity=0.177 Sum_probs=103.4
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCC--EEEEEeCCCcEEEe
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGH--RFASAALDGTVCTW 2298 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~--~LASgS~DgTVkLW 2298 (2389)
.||+|+.+|.|.+|||||+|||||||++.+|+|+++.+. .+.|++|+|+|.++ .||.|-+ +.+-|-
T Consensus 402 ~Vr~iSvdp~G~wlasGsdDGtvriWEi~TgRcvr~~~~-----------d~~I~~vaw~P~~~~~vLAvA~~-~~~~iv 469 (733)
T KOG0650|consen 402 LVRSISVDPSGEWLASGSDDGTVRIWEIATGRCVRTVQF-----------DSEIRSVAWNPLSDLCVLAVAVG-ECVLIV 469 (733)
T ss_pred eEEEEEecCCcceeeecCCCCcEEEEEeecceEEEEEee-----------cceeEEEEecCCCCceeEEEEec-CceEEe
Confidence 689999999999999999999999999999999999852 25699999999985 4444444 335555
Q ss_pred eCCCCCc--------------------------------cCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080 2299 QLEVGGR--------------------------------SNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus 2299 Dl~tggr--------------------------------s~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
|..-|.+ +..+-+.....|.+.|++|.|+. .|.+|||.-..+..+.|
T Consensus 470 np~~G~~~e~~~t~ell~~~~~~~~p~~~~~~W~~~~~~e~~~~v~~~I~~~k~i~~vtWHr-kGDYlatV~~~~~~~~V 548 (733)
T KOG0650|consen 470 NPIFGDRLEVGPTKELLASAPNESEPDAAVVTWSRASLDELEKGVCIVIKHPKSIRQVTWHR-KGDYLATVMPDSGNKSV 548 (733)
T ss_pred CccccchhhhcchhhhhhcCCCccCCcccceeechhhhhhhccceEEEEecCCccceeeeec-CCceEEEeccCCCcceE
Confidence 4433311 00111234456889999999999 99999998655566789
Q ss_pred EEeeCCCCCCCceEEEEeecCcEEEEeecccch
Q 000080 2347 VVWDTLAPPTSSRASITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus 2347 rLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~ 2379 (2389)
-|.++-. ....-.|.--.+-|.++.|+|.--
T Consensus 549 liHQLSK--~~sQ~PF~kskG~vq~v~FHPs~p 579 (733)
T KOG0650|consen 549 LIHQLSK--RKSQSPFRKSKGLVQRVKFHPSKP 579 (733)
T ss_pred EEEeccc--ccccCchhhcCCceeEEEecCCCc
Confidence 9999832 222234444556677788877643
No 170
>KOG1188 consensus WD40 repeat protein [General function prediction only]
Probab=98.65 E-value=1.2e-07 Score=112.85 Aligned_cols=139 Identities=15% Similarity=0.212 Sum_probs=106.8
Q ss_pred ceeeccccccccccccccCCCCcCceeEEEEEEcC--CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCC
Q 000080 2195 GASALGWETQDDFEDYVDPPATVENISTRAFSSHP--LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALA 2272 (2389)
Q Consensus 2195 ~Asg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsP--dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~ 2272 (2389)
..+-+.|++...++.|.-++++++.+ .|.. .+..+.||+.||+||+||++.......+. ..++ | ..
T Consensus 51 sv~lyd~~tg~~l~~fk~~~~~~N~v-----rf~~~ds~h~v~s~ssDG~Vr~wD~Rs~~e~a~~~-~~~~--~----~~ 118 (376)
T KOG1188|consen 51 SVRLYDKGTGQLLEEFKGPPATTNGV-----RFISCDSPHGVISCSSDGTVRLWDIRSQAESARIS-WTQQ--S----GT 118 (376)
T ss_pred eEEEEeccchhhhheecCCCCcccce-----EEecCCCCCeeEEeccCCeEEEEEeecchhhhhee-ccCC--C----CC
Confidence 34568899999999999999998765 3433 34469999999999999998765443332 1222 1 14
Q ss_pred CEEEEEECCCCCEEEEEe----CCCcEEEeeCCCCCccCccccee-eeecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080 2273 SISALQFDHYGHRFASAA----LDGTVCTWQLEVGGRSNVRPMES-CLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus 2273 ~V~sVaFSPDG~~LASgS----~DgTVkLWDl~tggrs~~k~l~t-l~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
.-.+++.+-.++.+|.|. .|-.|.+||++... +++.. ...|...|+.|.|+|.+-++|+|| |-||.|.
T Consensus 119 ~f~~ld~nck~~ii~~GtE~~~s~A~v~lwDvR~~q----q~l~~~~eSH~DDVT~lrFHP~~pnlLlSG---SvDGLvn 191 (376)
T KOG1188|consen 119 PFICLDLNCKKNIIACGTELTRSDASVVLWDVRSEQ----QLLRQLNESHNDDVTQLRFHPSDPNLLLSG---SVDGLVN 191 (376)
T ss_pred cceEeeccCcCCeEEeccccccCceEEEEEEecccc----chhhhhhhhccCcceeEEecCCCCCeEEee---cccceEE
Confidence 567888888999999987 47889999999742 33433 355999999999999999999996 7999999
Q ss_pred EeeCC
Q 000080 2348 VWDTL 2352 (2389)
Q Consensus 2348 LWD~l 2352 (2389)
|.|+.
T Consensus 192 lfD~~ 196 (376)
T KOG1188|consen 192 LFDTK 196 (376)
T ss_pred eeecC
Confidence 99984
No 171
>KOG0650 consensus WD40 repeat nucleolar protein Bop1, involved in ribosome biogenesis [Translation, ribosomal structure and biogenesis]
Probab=98.65 E-value=7e-07 Score=111.44 Aligned_cols=235 Identities=17% Similarity=0.290 Sum_probs=142.0
Q ss_pred CCCC---CCCCcccc------cccccccCCCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCccccccccccccee
Q 000080 16 CVDP---TEHLPLAF------LRSEFIPTAPTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQ 86 (2389)
Q Consensus 16 ~~~~---~~~lpl~~------~~~~~ip~ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Q 86 (2389)
-+|| ||.||-+- ..-.++=-+|+--+++|+-.|. | +|+|-|+..+.|-.| .=.++ .++ -
T Consensus 369 niDpe~LiPkLPsp~dLrPFPt~~~lvyrGHtg~Vr~iSvdp~--G-~wlasGsdDGtvriW--Ei~Tg-Rcv------r 436 (733)
T KOG0650|consen 369 NIDPESLIPKLPSPKDLRPFPTRCALVYRGHTGLVRSISVDPS--G-EWLASGSDDGTVRIW--EIATG-RCV------R 436 (733)
T ss_pred cCCHHHhcccCCChhhcCCCcceeeeeEeccCCeEEEEEecCC--c-ceeeecCCCCcEEEE--Eeecc-eEE------E
Confidence 3554 77777543 2334455678888899988774 8 699999999999999 32222 233 2
Q ss_pred eeeccCCCCCeeEEEEcCCCCCCCcEEEecCCeEEEEeeC-C-------------------CCCCCCccceee-------
Q 000080 87 VFALSDNSLPVTSISWSPETPSIGQLAAASENCIFVFAHD-S-------------------ASSKGSFCWSQN------- 139 (2389)
Q Consensus 87 viegh~d~~dVk~VaWSPd~~~~GeIaASyDntIRVw~~d-~-------------------~~~kgd~~W~~~------- 139 (2389)
.++.- ..|.||+|+|. +...-|||++++++-|-.+. . ..+..-..|...
T Consensus 437 ~~~~d---~~I~~vaw~P~-~~~~vLAvA~~~~~~ivnp~~G~~~e~~~t~ell~~~~~~~~p~~~~~~W~~~~~~e~~~ 512 (733)
T KOG0650|consen 437 TVQFD---SEIRSVAWNPL-SDLCVLAVAVGECVLIVNPIFGDRLEVGPTKELLASAPNESEPDAAVVTWSRASLDELEK 512 (733)
T ss_pred EEeec---ceeEEEEecCC-CCceeEEEEecCceEEeCccccchhhhcchhhhhhcCCCccCCcccceeechhhhhhhcc
Confidence 22222 25999999995 44445667888776555431 0 000111256543
Q ss_pred ---EEecccceEEEEeecCCCCeEEEEecc-----eEEeeccCCcEEEEEEeeccccceEEEEeecCCCc-eEeeec-cc
Q 000080 140 ---AILVQGTKVEAIEWTGSGDGIVAGGME-----TVLWKKKNTLWEIAWKFKENYPQNLVSATWSIEGP-SATAAS-MS 209 (2389)
Q Consensus 140 ---~tL~hssTV~sIAWSpdG~rLaSggdD-----V~IW~~~~s~Wecvwt~~~~~~~~ivsvaWSpdG~-fATag~-di 209 (2389)
.++.|..+|+.|.|...|+||+++.-+ |.|.|.....=++-+. .....+..+.+-|.-. |..|++ .+
T Consensus 513 ~v~~~I~~~k~i~~vtWHrkGDYlatV~~~~~~~~VliHQLSK~~sQ~PF~---kskG~vq~v~FHPs~p~lfVaTq~~v 589 (733)
T KOG0650|consen 513 GVCIVIKHPKSIRQVTWHRKGDYLATVMPDSGNKSVLIHQLSKRKSQSPFR---KSKGLVQRVKFHPSKPYLFVATQRSV 589 (733)
T ss_pred ceEEEEecCCccceeeeecCCceEEEeccCCCcceEEEEecccccccCchh---hcCCceeEEEecCCCceEEEEeccce
Confidence 556688999999999999999966653 7788854433333321 1223455667777655 333333 33
Q ss_pred c-cccC----------C---------CCCCCceeEEEeeCCCc---------cceeecccCCCCeeEEEeccCCCCCCCC
Q 000080 210 Q-LDLL----------G---------PKEAGKCVFICCSDGKS---------EYIKLELCHPQPVSMVQWRPSTRRHSPG 260 (2389)
Q Consensus 210 k-f~~~----------~---------~~~~~kpV~V~~~dg~~---------~~~~ve~aH~qdVn~V~W~Ps~~~~~~~ 260 (2389)
+ |... + .+..++ +.+.-+|.+. --......|...|..|+.||
T Consensus 590 RiYdL~kqelvKkL~tg~kwiS~msihp~GDn-li~gs~d~k~~WfDldlsskPyk~lr~H~~avr~Va~H~-------- 660 (733)
T KOG0650|consen 590 RIYDLSKQELVKKLLTGSKWISSMSIHPNGDN-LILGSYDKKMCWFDLDLSSKPYKTLRLHEKAVRSVAFHK-------- 660 (733)
T ss_pred EEEehhHHHHHHHHhcCCeeeeeeeecCCCCe-EEEecCCCeeEEEEcccCcchhHHhhhhhhhhhhhhhcc--------
Confidence 3 1110 0 011111 1111112111 01123467999999999999
Q ss_pred CCccccCceEEeeecCCeEEEEE
Q 000080 261 DTKRSQRHVLLTCCLDGTVRLWC 283 (2389)
Q Consensus 261 Dgk~~~~nILAScSdDgTVRLW~ 283 (2389)
.-.+++|||+||||-|.-
T Consensus 661 -----ryPLfas~sdDgtv~Vfh 678 (733)
T KOG0650|consen 661 -----RYPLFASGSDDGTVIVFH 678 (733)
T ss_pred -----ccceeeeecCCCcEEEEe
Confidence 357899999999998876
No 172
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=98.62 E-value=5.8e-07 Score=107.23 Aligned_cols=154 Identities=12% Similarity=0.076 Sum_probs=99.0
Q ss_pred EEEEEEcCCCCeE-EEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-CCcEEEee
Q 000080 2222 TRAFSSHPLRPFF-LVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-DGTVCTWQ 2299 (2389)
Q Consensus 2222 VrsVAFsPdG~~L-ASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-DgTVkLWD 2299 (2389)
...++|+|+|+++ ++...+++|++||+.+...+........ ..+ .| ...+.++|+|||+++.++.. +++|.+||
T Consensus 128 ~~~~~~~p~g~~l~v~~~~~~~v~v~d~~~~g~l~~~~~~~~-~~~-~g--~~p~~~~~~pdg~~lyv~~~~~~~v~v~~ 203 (330)
T PRK11028 128 CHSANIDPDNRTLWVPCLKEDRIRLFTLSDDGHLVAQEPAEV-TTV-EG--AGPRHMVFHPNQQYAYCVNELNSSVDVWQ 203 (330)
T ss_pred ccEeEeCCCCCEEEEeeCCCCEEEEEEECCCCcccccCCCce-ecC-CC--CCCceEEECCCCCEEEEEecCCCEEEEEE
Confidence 3677999999987 5566779999999976432211000000 001 12 33578999999999988876 99999999
Q ss_pred CCCCCccCcccceeeeec------CCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecC---cEE
Q 000080 2300 LEVGGRSNVRPMESCLCF------SSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEG---LYD 2370 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gH------s~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~---~V~ 2370 (2389)
++.++. ..+.+.++..+ .....+++|+| ||++|.++. ..+++|.+||+. +......+.+|.. ..+
T Consensus 204 ~~~~~~-~~~~~~~~~~~p~~~~~~~~~~~i~~~p-dg~~lyv~~--~~~~~I~v~~i~--~~~~~~~~~~~~~~~~~p~ 277 (330)
T PRK11028 204 LKDPHG-EIECVQTLDMMPADFSDTRWAADIHITP-DGRHLYACD--RTASLISVFSVS--EDGSVLSFEGHQPTETQPR 277 (330)
T ss_pred EeCCCC-CEEEEEEEecCCCcCCCCccceeEEECC-CCCEEEEec--CCCCeEEEEEEe--CCCCeEEEeEEEeccccCC
Confidence 974210 11233333222 22344689999 999988863 467899999983 2222233444422 456
Q ss_pred EEeecccchhhhccc
Q 000080 2371 LFLPLKLLNFALSKC 2385 (2389)
Q Consensus 2371 svA~~~~~~~~~s~~ 2385 (2389)
.++++|+|+|+..-+
T Consensus 278 ~~~~~~dg~~l~va~ 292 (330)
T PRK11028 278 GFNIDHSGKYLIAAG 292 (330)
T ss_pred ceEECCCCCEEEEEE
Confidence 889999999987544
No 173
>KOG0322 consensus G-protein beta subunit-like protein GNB1L, contains WD repeats [General function prediction only]
Probab=98.61 E-value=3.8e-08 Score=113.84 Aligned_cols=76 Identities=18% Similarity=0.291 Sum_probs=69.7
Q ss_pred CCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCc
Q 000080 2215 ATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGT 2294 (2389)
Q Consensus 2215 atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgT 2294 (2389)
.+++|.+|..|..-||++++||++.|+.||++.+++.+.+..++ +|.+.|.+|+|+||-..+|+||.|++
T Consensus 247 ~~lknpGv~gvrIRpD~KIlATAGWD~RiRVyswrtl~pLAVLk----------yHsagvn~vAfspd~~lmAaaskD~r 316 (323)
T KOG0322|consen 247 ITLKNPGVSGVRIRPDGKILATAGWDHRIRVYSWRTLNPLAVLK----------YHSAGVNAVAFSPDCELMAAASKDAR 316 (323)
T ss_pred EEecCCCccceEEccCCcEEeecccCCcEEEEEeccCCchhhhh----------hhhcceeEEEeCCCCchhhhccCCce
Confidence 55667777888999999999999999999999999999888774 68899999999999999999999999
Q ss_pred EEEeeC
Q 000080 2295 VCTWQL 2300 (2389)
Q Consensus 2295 VkLWDl 2300 (2389)
|.||++
T Consensus 317 ISLWkL 322 (323)
T KOG0322|consen 317 ISLWKL 322 (323)
T ss_pred EEeeec
Confidence 999986
No 174
>KOG0290 consensus Conserved WD40 repeat-containing protein AN11 [Function unknown]
Probab=98.61 E-value=1.7e-07 Score=109.61 Aligned_cols=120 Identities=18% Similarity=0.255 Sum_probs=98.3
Q ss_pred eEEEEEEcC-CCCeEEEEeCCCcEEEeecCCCce--eeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEE
Q 000080 2221 STRAFSSHP-LRPFFLVGSSNTHIYLWEFGKDKA--TATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVC 2296 (2389)
Q Consensus 2221 ~VrsVAFsP-dG~~LASGS~DgTIRLWDl~tGk~--l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVk 2296 (2389)
++.+..|+- |-++|.+.|-|+|..+||+++|.. ++|- + ..|...|..|+|.-+| +.|||.+.||.||
T Consensus 152 PlTSFDWne~dp~~igtSSiDTTCTiWdie~~~~~~vkTQ--L-------IAHDKEV~DIaf~~~s~~~FASvgaDGSvR 222 (364)
T KOG0290|consen 152 PLTSFDWNEVDPNLIGTSSIDTTCTIWDIETGVSGTVKTQ--L-------IAHDKEVYDIAFLKGSRDVFASVGADGSVR 222 (364)
T ss_pred cccccccccCCcceeEeecccCeEEEEEEeeccccceeeE--E-------EecCcceeEEEeccCccceEEEecCCCcEE
Confidence 557777776 455899999999999999999843 4442 1 2467999999999987 7999999999999
Q ss_pred EeeCCCCCc-------------------------------------------cCcccceeeeecCCCeeEEEEecCCCCE
Q 000080 2297 TWQLEVGGR-------------------------------------------SNVRPMESCLCFSSHAMDVSYITSSGSV 2333 (2389)
Q Consensus 2297 LWDl~tggr-------------------------------------------s~~k~l~tl~gHs~~V~sVAFSP~DGsl 2333 (2389)
+.|++.-.. .--.|+..+++|.+.|+.++|.|.++..
T Consensus 223 mFDLR~leHSTIIYE~p~~~~pLlRLswnkqDpnymATf~~dS~~V~iLDiR~P~tpva~L~~H~a~VNgIaWaPhS~~h 302 (364)
T KOG0290|consen 223 MFDLRSLEHSTIIYEDPSPSTPLLRLSWNKQDPNYMATFAMDSNKVVILDIRVPCTPVARLRNHQASVNGIAWAPHSSSH 302 (364)
T ss_pred EEEecccccceEEecCCCCCCcceeeccCcCCchHHhhhhcCCceEEEEEecCCCcceehhhcCcccccceEecCCCCce
Confidence 999976321 0113567789999999999999999999
Q ss_pred EEEeecCCCCCeEEEeeCC
Q 000080 2334 IAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2334 LASAG~sS~D~TVrLWD~l 2352 (2389)
|+|+| +|..+-|||+-
T Consensus 303 ictaG---DD~qaliWDl~ 318 (364)
T KOG0290|consen 303 ICTAG---DDCQALIWDLQ 318 (364)
T ss_pred eeecC---CcceEEEEecc
Confidence 99986 99999999984
No 175
>KOG1272 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=98.61 E-value=3.6e-08 Score=120.16 Aligned_cols=143 Identities=15% Similarity=0.177 Sum_probs=122.9
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
++|..+.|=|.--+|+++|..|-++-=|+.+|+.+..++. | .+.+..+.=+|-.-.+-.|-..|||.||.
T Consensus 210 ~~v~rLeFLPyHfLL~~~~~~G~L~Y~DVS~GklVa~~~t---------~-~G~~~vm~qNP~NaVih~GhsnGtVSlWS 279 (545)
T KOG1272|consen 210 IRVARLEFLPYHFLLVAASEAGFLKYQDVSTGKLVASIRT---------G-AGRTDVMKQNPYNAVIHLGHSNGTVSLWS 279 (545)
T ss_pred CchhhhcccchhheeeecccCCceEEEeechhhhhHHHHc---------c-CCccchhhcCCccceEEEcCCCceEEecC
Confidence 5788999999999999999999999999999999877751 1 26688889999999999999999999999
Q ss_pred CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccch
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~ 2379 (2389)
.+.. .|+..+.||.+.|++||+.+ +|+++||+| .|+.|+|||+. .-..++++.- ..++..+++|-.|.
T Consensus 280 P~sk-----ePLvKiLcH~g~V~siAv~~-~G~YMaTtG---~Dr~~kIWDlR--~~~ql~t~~t-p~~a~~ls~Sqkgl 347 (545)
T KOG1272|consen 280 PNSK-----EPLVKILCHRGPVSSIAVDR-GGRYMATTG---LDRKVKIWDLR--NFYQLHTYRT-PHPASNLSLSQKGL 347 (545)
T ss_pred CCCc-----chHHHHHhcCCCcceEEECC-CCcEEeecc---cccceeEeeec--cccccceeec-CCCccccccccccc
Confidence 8874 58888999999999999999 999999986 89999999984 2334555554 56788999999999
Q ss_pred hhhcc
Q 000080 2380 FALSK 2384 (2389)
Q Consensus 2380 ~~~s~ 2384 (2389)
-|||-
T Consensus 348 LA~~~ 352 (545)
T KOG1272|consen 348 LALSY 352 (545)
T ss_pred eeeec
Confidence 88874
No 176
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=98.61 E-value=1.4e-07 Score=115.07 Aligned_cols=149 Identities=11% Similarity=0.153 Sum_probs=114.7
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.|++++|+.||+.|++.+.+|.|.+||+++..+++++.. .|. -.=++++.|++|.+||+||.-|-|-|+|.
T Consensus 346 ~v~~~~fsSdsk~l~~~~~~GeV~v~nl~~~~~~~rf~D-~G~--------v~gts~~~S~ng~ylA~GS~~GiVNIYd~ 416 (514)
T KOG2055|consen 346 VVSDFTFSSDSKELLASGGTGEVYVWNLRQNSCLHRFVD-DGS--------VHGTSLCISLNGSYLATGSDSGIVNIYDG 416 (514)
T ss_pred EEeeEEEecCCcEEEEEcCCceEEEEecCCcceEEEEee-cCc--------cceeeeeecCCCceEEeccCcceEEEecc
Confidence 479999999999999999999999999999999999852 221 12378899999999999999999999996
Q ss_pred CCCC-ccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEE---EeecCcEEEEeecc
Q 000080 2301 EVGG-RSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASI---TCHEGLYDLFLPLK 2376 (2389)
Q Consensus 2301 ~tgg-rs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL---~GH~~~V~svA~~~ 2376 (2389)
++-- -.+++|+.++..-...|++++|+| |+++||-++ ...++++||=-+ |.-+....+ ..--+-|+|+||+|
T Consensus 417 ~s~~~s~~PkPik~~dNLtt~Itsl~Fn~-d~qiLAiaS-~~~knalrLVHv--PS~TVFsNfP~~n~~vg~vtc~aFSP 492 (514)
T KOG2055|consen 417 NSCFASTNPKPIKTVDNLTTAITSLQFNH-DAQILAIAS-RVKKNALRLVHV--PSCTVFSNFPTSNTKVGHVTCMAFSP 492 (514)
T ss_pred chhhccCCCCchhhhhhhheeeeeeeeCc-chhhhhhhh-hccccceEEEec--cceeeeccCCCCCCcccceEEEEecC
Confidence 6520 026789999999999999999999 999999874 237788999776 211111111 22335589999999
Q ss_pred -cchhhh
Q 000080 2377 -LLNFAL 2382 (2389)
Q Consensus 2377 -~~~~~~ 2382 (2389)
.|-.|+
T Consensus 493 ~sG~lAv 499 (514)
T KOG2055|consen 493 NSGYLAV 499 (514)
T ss_pred CCceEEe
Confidence 444444
No 177
>KOG2919 consensus Guanine nucleotide-binding protein [General function prediction only]
Probab=98.60 E-value=1.6e-07 Score=111.01 Aligned_cols=145 Identities=17% Similarity=0.199 Sum_probs=112.7
Q ss_pred EcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCC---EEEEEECCCCCEEEEEeCCCcEEEeeCCCC
Q 000080 2227 SHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALAS---ISALQFDHYGHRFASAALDGTVCTWQLEVG 2303 (2389)
Q Consensus 2227 FsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~---V~sVaFSPDG~~LASgS~DgTVkLWDl~tg 2303 (2389)
-.|+..++|+.|.|.-|+|||.-+|+....|+.. + |.+. -.+++|||||..|..|. .++||+.|+...
T Consensus 119 ~qP~t~l~a~ssr~~PIh~wdaftG~lraSy~~y---d-----h~de~taAhsL~Fs~DGeqlfaGy-krcirvFdt~Rp 189 (406)
T KOG2919|consen 119 DQPSTNLFAVSSRDQPIHLWDAFTGKLRASYRAY---D-----HQDEYTAAHSLQFSPDGEQLFAGY-KRCIRVFDTSRP 189 (406)
T ss_pred CCCccceeeeccccCceeeeeccccccccchhhh---h-----hHHhhhhheeEEecCCCCeEeecc-cceEEEeeccCC
Confidence 3477889999999999999999999998888632 1 3343 35799999999887664 589999999444
Q ss_pred CccCcccceeee-----ecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080 2304 GRSNVRPMESCL-----CFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus 2304 grs~~k~l~tl~-----gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
||- .+.++.. |..+.+.+++|+|-+.+.+|.++ -.+++-|+.- -....++.|-||.++|+-+...|+|
T Consensus 190 Gr~--c~vy~t~~~~k~gq~giisc~a~sP~~~~~~a~gs---Y~q~~giy~~--~~~~pl~llggh~gGvThL~~~edG 262 (406)
T KOG2919|consen 190 GRD--CPVYTTVTKGKFGQKGIISCFAFSPMDSKTLAVGS---YGQRVGIYND--DGRRPLQLLGGHGGGVTHLQWCEDG 262 (406)
T ss_pred CCC--CcchhhhhcccccccceeeeeeccCCCCcceeeec---ccceeeeEec--CCCCceeeecccCCCeeeEEeccCc
Confidence 442 2333333 33788899999998888999864 5677777663 1345589999999999999999999
Q ss_pred hhhhccccc
Q 000080 2379 NFALSKCRC 2387 (2389)
Q Consensus 2379 ~~~~s~~~~ 2387 (2389)
|...|-.||
T Consensus 263 n~lfsGaRk 271 (406)
T KOG2919|consen 263 NKLFSGARK 271 (406)
T ss_pred CeecccccC
Confidence 999998887
No 178
>PRK02889 tolB translocation protein TolB; Provisional
Probab=98.60 E-value=3.3e-07 Score=114.27 Aligned_cols=144 Identities=12% Similarity=0.055 Sum_probs=98.7
Q ss_pred eEEEEEEcCCCCeEEEEeCC---CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEE-EEeCCCcEE
Q 000080 2221 STRAFSSHPLRPFFLVGSSN---THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFA-SAALDGTVC 2296 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~D---gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LA-SgS~DgTVk 2296 (2389)
.+.+.+|+|||+.||..+.+ ..|++||+.+|+..+... .+ ..+.+.+|||||+.|| +.+.||..+
T Consensus 197 ~v~~p~wSPDG~~la~~s~~~~~~~I~~~dl~~g~~~~l~~-~~----------g~~~~~~~SPDG~~la~~~~~~g~~~ 265 (427)
T PRK02889 197 PIISPAWSPDGTKLAYVSFESKKPVVYVHDLATGRRRVVAN-FK----------GSNSAPAWSPDGRTLAVALSRDGNSQ 265 (427)
T ss_pred CcccceEcCCCCEEEEEEccCCCcEEEEEECCCCCEEEeec-CC----------CCccceEECCCCCEEEEEEccCCCce
Confidence 34778999999999987753 469999999887643211 11 2356899999999987 567889888
Q ss_pred EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080 2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus 2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
||.++..+ .....+..|...+.+.+|+| ||+.|+.++ ..++..+||.+....+ ..+.+..+.......+++|
T Consensus 266 Iy~~d~~~----~~~~~lt~~~~~~~~~~wSp-DG~~l~f~s--~~~g~~~Iy~~~~~~g-~~~~lt~~g~~~~~~~~Sp 337 (427)
T PRK02889 266 IYTVNADG----SGLRRLTQSSGIDTEPFFSP-DGRSIYFTS--DRGGAPQIYRMPASGG-AAQRVTFTGSYNTSPRISP 337 (427)
T ss_pred EEEEECCC----CCcEECCCCCCCCcCeEEcC-CCCEEEEEe--cCCCCcEEEEEECCCC-ceEEEecCCCCcCceEECC
Confidence 88765322 12344555666667789999 999988753 3456788887643333 3344433333345678999
Q ss_pred cchhhhc
Q 000080 2377 LLNFALS 2383 (2389)
Q Consensus 2377 ~~~~~~s 2383 (2389)
+|++++.
T Consensus 338 DG~~Ia~ 344 (427)
T PRK02889 338 DGKLLAY 344 (427)
T ss_pred CCCEEEE
Confidence 9999764
No 179
>KOG0974 consensus WD-repeat protein WDR6, WD repeat superfamily [General function prediction only]
Probab=98.59 E-value=1.2e-07 Score=123.85 Aligned_cols=112 Identities=16% Similarity=0.128 Sum_probs=92.8
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
..+-++.++-||++++|.|+|.+||+|++++++.... + -.||+++|+++.|.|. .++|++.|.|.++|+
T Consensus 176 G~iF~i~~s~dg~~i~s~SdDRsiRlW~i~s~~~~~~------~---~fgHsaRvw~~~~~~n--~i~t~gedctcrvW~ 244 (967)
T KOG0974|consen 176 GSIFSIVTSLDGRYIASVSDDRSIRLWPIDSREVLGC------T---GFGHSARVWACCFLPN--RIITVGEDCTCRVWG 244 (967)
T ss_pred CceEEEEEccCCcEEEEEecCcceeeeecccccccCc------c---cccccceeEEEEeccc--eeEEeccceEEEEEe
Confidence 3568999999999999999999999999998876541 1 1479999999999999 999999999999997
Q ss_pred CCCCCccCcccceeeeecC-CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080 2300 LEVGGRSNVRPMESCLCFS-SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs-~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
.+.. .+..+.+|. +.++.++..+ +-.++.|+| +|+++|+||..
T Consensus 245 ~~~~------~l~~y~~h~g~~iw~~~~~~-~~~~~vT~g---~Ds~lk~~~l~ 288 (967)
T KOG0974|consen 245 VNGT------QLEVYDEHSGKGIWKIAVPI-GVIIKVTGG---NDSTLKLWDLN 288 (967)
T ss_pred cccc------eehhhhhhhhcceeEEEEcC-CceEEEeec---cCcchhhhhhh
Confidence 7642 344566676 6788999998 556666765 99999999973
No 180
>KOG4378 consensus Nuclear protein COP1 [Signal transduction mechanisms]
Probab=98.59 E-value=3.9e-07 Score=111.61 Aligned_cols=160 Identities=13% Similarity=0.147 Sum_probs=124.2
Q ss_pred ceeeccccccccccccc---------cCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC
Q 000080 2195 GASALGWETQDDFEDYV---------DPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV 2265 (2389)
Q Consensus 2195 ~Asg~~~d~~~~~~~~~---------d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~ 2265 (2389)
..+| |-....++|++. |+.- .|..|.++-+..+||++|..|.|.|-.+.++....+|. |
T Consensus 94 ~~sg-G~~~~Vkiwdl~~kl~hr~lkdh~s-----tvt~v~YN~~DeyiAsvs~gGdiiih~~~t~~~tt~f~----~-- 161 (673)
T KOG4378|consen 94 EISG-GQSGCVKIWDLRAKLIHRFLKDHQS-----TVTYVDYNNTDEYIASVSDGGDIIIHGTKTKQKTTTFT----I-- 161 (673)
T ss_pred eecc-CcCceeeehhhHHHHHhhhccCCcc-----eeEEEEecCCcceeEEeccCCcEEEEecccCcccccee----c--
Confidence 3445 556667777763 3332 24778999999999999999999999999998887774 2
Q ss_pred CCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCCCccCcccce-eeeecCCCeeEEEEecCCCCEEEEeecCCCC
Q 000080 2266 PPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEVGGRSNVRPME-SCLCFSSHAMDVSYITSSGSVIAAAGHSSNG 2343 (2389)
Q Consensus 2266 p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tggrs~~k~l~-tl~gHs~~V~sVAFSP~DGslLASAG~sS~D 2343 (2389)
+....|+-+.|||-- ..|.++|.||+|.|||+... .|+. -...|+.+..+|+|+|.+..+|||.| .|
T Consensus 162 ---~sgqsvRll~ys~skr~lL~~asd~G~VtlwDv~g~-----sp~~~~~~~HsAP~~gicfspsne~l~vsVG---~D 230 (673)
T KOG4378|consen 162 ---DSGQSVRLLRYSPSKRFLLSIASDKGAVTLWDVQGM-----SPIFHASEAHSAPCRGICFSPSNEALLVSVG---YD 230 (673)
T ss_pred ---CCCCeEEEeecccccceeeEeeccCCeEEEEeccCC-----CcccchhhhccCCcCcceecCCccceEEEec---cc
Confidence 123678999999997 46778999999999999843 3443 35679999999999998888999986 89
Q ss_pred CeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080 2344 INVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus 2344 ~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
+.|.++|+. ......+|. .+.+..+||+++.|-.
T Consensus 231 kki~~yD~~--s~~s~~~l~-y~~Plstvaf~~~G~~ 264 (673)
T KOG4378|consen 231 KKINIYDIR--SQASTDRLT-YSHPLSTVAFSECGTY 264 (673)
T ss_pred ceEEEeecc--cccccceee-ecCCcceeeecCCceE
Confidence 999999984 334455664 4556889999998864
No 181
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=98.59 E-value=3.2e-07 Score=105.37 Aligned_cols=138 Identities=20% Similarity=0.266 Sum_probs=102.4
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCce----eeEecccCCCCCCCCCCC-----CCEEEEEECCCCCEEEEEe
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKA----TATYGVLPAANVPPPYAL-----ASISALQFDHYGHRFASAA 2290 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~----l~Tl~vl~gh~~p~~GH~-----~~V~sVaFSPDG~~LASgS 2290 (2389)
.+|..++|+ ..+|+||++ |.||=|.++.-.. .+.+++ -+|.|. ..|+++-..|.-+-+..|+
T Consensus 63 gpiy~~~f~--d~~Lls~gd-G~V~gw~W~E~~es~~~K~lwe~------~~P~~~~~~evPeINam~ldP~enSi~~Ag 133 (325)
T KOG0649|consen 63 GPIYYLAFH--DDFLLSGGD-GLVYGWEWNEEEESLATKRLWEV------KIPMQVDAVEVPEINAMWLDPSENSILFAG 133 (325)
T ss_pred CCeeeeeee--hhheeeccC-ceEEEeeehhhhhhccchhhhhh------cCccccCcccCCccceeEeccCCCcEEEec
Confidence 467899999 456888765 9999999873322 111211 112333 4689999999999899999
Q ss_pred CCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEe--ec--
Q 000080 2291 LDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITC--HE-- 2366 (2389)
Q Consensus 2291 ~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~G--H~-- 2366 (2389)
.|+.+.-||+++| +..+++.||++.|-+|+--..+|++| || ++||||||||+ .++++++.++- |+
T Consensus 134 GD~~~y~~dlE~G-----~i~r~~rGHtDYvH~vv~R~~~~qil-sG---~EDGtvRvWd~--kt~k~v~~ie~yk~~~~ 202 (325)
T KOG0649|consen 134 GDGVIYQVDLEDG-----RIQREYRGHTDYVHSVVGRNANGQIL-SG---AEDGTVRVWDT--KTQKHVSMIEPYKNPNL 202 (325)
T ss_pred CCeEEEEEEecCC-----EEEEEEcCCcceeeeeeecccCccee-ec---CCCccEEEEec--cccceeEEeccccChhh
Confidence 9999999999998 46688999999999998844366655 65 69999999998 57888877643 22
Q ss_pred ------CcEEEEeeccc
Q 000080 2367 ------GLYDLFLPLKL 2377 (2389)
Q Consensus 2367 ------~~V~svA~~~~ 2377 (2389)
.+|.++|.+++
T Consensus 203 lRp~~g~wigala~~ed 219 (325)
T KOG0649|consen 203 LRPDWGKWIGALAVNED 219 (325)
T ss_pred cCcccCceeEEEeccCc
Confidence 34567776654
No 182
>KOG1310 consensus WD40 repeat protein [General function prediction only]
Probab=98.58 E-value=1.3e-07 Score=116.69 Aligned_cols=122 Identities=16% Similarity=0.211 Sum_probs=102.1
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC--CEEEEEeCCCcEEE
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG--HRFASAALDGTVCT 2297 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG--~~LASgS~DgTVkL 2297 (2389)
.-|.+++|+.||.+|||||+|..+.+||.-.-+.+.... .||.+-|.++.|=|.- +.++||+.|.-|+|
T Consensus 51 GCVN~LeWn~dG~lL~SGSDD~r~ivWd~~~~KllhsI~---------TgHtaNIFsvKFvP~tnnriv~sgAgDk~i~l 121 (758)
T KOG1310|consen 51 GCVNCLEWNADGELLASGSDDTRLIVWDPFEYKLLHSIS---------TGHTANIFSVKFVPYTNNRIVLSGAGDKLIKL 121 (758)
T ss_pred ceecceeecCCCCEEeecCCcceEEeecchhcceeeeee---------cccccceeEEeeeccCCCeEEEeccCcceEEE
Confidence 457899999999999999999999999998778777763 5789999999999873 68999999999999
Q ss_pred eeCCCC---C--ccCcccceeeeecCCCeeEEEEecCCC-CEEEEeecCCCCCeEEEeeCCCC
Q 000080 2298 WQLEVG---G--RSNVRPMESCLCFSSHAMDVSYITSSG-SVIAAAGHSSNGINVVVWDTLAP 2354 (2389)
Q Consensus 2298 WDl~tg---g--rs~~k~l~tl~gHs~~V~sVAFSP~DG-slLASAG~sS~D~TVrLWD~l~~ 2354 (2389)
.|+... + .....+...+.||...|-.+|--| +| ..+-+| |+|||||=.|+..+
T Consensus 122 fdl~~~~~~~~d~~~~~~~~~~~cht~rVKria~~p-~~Phtfwsa---sEDGtirQyDiREp 180 (758)
T KOG1310|consen 122 FDLDSSKEGGMDHGMEETTRCWSCHTDRVKRIATAP-NGPHTFWSA---SEDGTIRQYDIREP 180 (758)
T ss_pred EecccccccccccCccchhhhhhhhhhhhhheecCC-CCCceEEEe---cCCcceeeecccCC
Confidence 999851 0 002245677899999999999999 66 677776 59999999999643
No 183
>KOG1408 consensus WD40 repeat protein [Function unknown]
Probab=98.55 E-value=3.3e-07 Score=115.22 Aligned_cols=154 Identities=16% Similarity=0.165 Sum_probs=120.8
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCC-----------------------------------
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAAN----------------------------------- 2264 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~----------------------------------- 2264 (2389)
+++|+|+.+|+|+.||+|-.-|++|++|+..-+.+.+. ++|.
T Consensus 460 ~G~R~~~vSp~gqhLAsGDr~GnlrVy~Lq~l~~~~~~---eAHesEilcLeyS~p~~~~kLLASasrdRlIHV~Dv~rn 536 (1080)
T KOG1408|consen 460 FGFRALAVSPDGQHLASGDRGGNLRVYDLQELEYTCFM---EAHESEILCLEYSFPVLTNKLLASASRDRLIHVYDVKRN 536 (1080)
T ss_pred cceEEEEECCCcceecccCccCceEEEEehhhhhhhhe---ecccceeEEEeecCchhhhHhhhhccCCceEEEEecccc
Confidence 57799999999999999999999999998643332211 2222
Q ss_pred C----CCCCCCCCEEEEEECCCC-------------------------------------------------CEEEEEeC
Q 000080 2265 V----PPPYALASISALQFDHYG-------------------------------------------------HRFASAAL 2291 (2389)
Q Consensus 2265 ~----p~~GH~~~V~sVaFSPDG-------------------------------------------------~~LASgS~ 2291 (2389)
+ ..-||+..|++|.|--.| +.++++..
T Consensus 537 y~l~qtld~HSssITsvKFa~~gln~~MiscGADksimFr~~qk~~~g~~f~r~t~t~~ktTlYDm~Vdp~~k~v~t~cQ 616 (1080)
T KOG1408|consen 537 YDLVQTLDGHSSSITSVKFACNGLNRKMISCGADKSIMFRVNQKASSGRLFPRHTQTLSKTTLYDMAVDPTSKLVVTVCQ 616 (1080)
T ss_pred cchhhhhcccccceeEEEEeecCCceEEEeccCchhhheehhccccCceeccccccccccceEEEeeeCCCcceEEEEec
Confidence 0 033566666666665444 46677888
Q ss_pred CCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEE
Q 000080 2292 DGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDL 2371 (2389)
Q Consensus 2292 DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~s 2371 (2389)
|+.|+++|++.|. ..+.++.-++|.+..-.|...| +|-+|||. ..|+|+.+.|. -+++|+....||...|+.
T Consensus 617 Drnirif~i~sgK--q~k~FKgs~~~eG~lIKv~lDP-SgiY~atS---csdktl~~~Df--~sgEcvA~m~GHsE~VTG 688 (1080)
T KOG1408|consen 617 DRNIRIFDIESGK--QVKSFKGSRDHEGDLIKVILDP-SGIYLATS---CSDKTLCFVDF--VSGECVAQMTGHSEAVTG 688 (1080)
T ss_pred ccceEEEeccccc--eeeeecccccCCCceEEEEECC-CccEEEEe---ecCCceEEEEe--ccchhhhhhcCcchheee
Confidence 9999999999874 4466777788988888899999 99999995 68999999998 579999999999999999
Q ss_pred Eeecccchhhhcc
Q 000080 2372 FLPLKLLNFALSK 2384 (2389)
Q Consensus 2372 vA~~~~~~~~~s~ 2384 (2389)
+-|.+|-+-..|-
T Consensus 689 ~kF~nDCkHlISv 701 (1080)
T KOG1408|consen 689 VKFLNDCKHLISV 701 (1080)
T ss_pred eeecccchhheee
Confidence 9999987766553
No 184
>KOG2919 consensus Guanine nucleotide-binding protein [General function prediction only]
Probab=98.55 E-value=3.4e-07 Score=108.33 Aligned_cols=137 Identities=15% Similarity=0.208 Sum_probs=112.4
Q ss_pred EEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-CCcEEEee
Q 000080 2222 TRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-DGTVCTWQ 2299 (2389)
Q Consensus 2222 VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-DgTVkLWD 2299 (2389)
+..++|||... .+|.||...++-|+....++.+.++. ||.+.|+.++|.+||++|-||+. |-.|-.||
T Consensus 210 isc~a~sP~~~~~~a~gsY~q~~giy~~~~~~pl~llg----------gh~gGvThL~~~edGn~lfsGaRk~dkIl~WD 279 (406)
T KOG2919|consen 210 ISCFAFSPMDSKTLAVGSYGQRVGIYNDDGRRPLQLLG----------GHGGGVTHLQWCEDGNKLFSGARKDDKILCWD 279 (406)
T ss_pred eeeeeccCCCCcceeeecccceeeeEecCCCCceeeec----------ccCCCeeeEEeccCcCeecccccCCCeEEEEe
Confidence 57889999766 99999999999999987777887763 67899999999999999999885 77899999
Q ss_pred CCCCCccCcccceeeeecCCCee-EEEEe--cCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAM-DVSYI--TSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~-sVAFS--P~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
++..+ .++..+..|...-+ .|-|. | +|++||+| +.||.|++||+. ..++.+..+..|..-|+.|+.+|
T Consensus 280 iR~~~----~pv~~L~rhv~~TNQRI~FDld~-~~~~LasG---~tdG~V~vwdlk-~~gn~~sv~~~~sd~vNgvslnP 350 (406)
T KOG2919|consen 280 IRYSR----DPVYALERHVGDTNQRILFDLDP-KGEILASG---DTDGSVRVWDLK-DLGNEVSVTGNYSDTVNGVSLNP 350 (406)
T ss_pred ehhcc----chhhhhhhhccCccceEEEecCC-CCceeecc---CCCccEEEEecC-CCCCcccccccccccccceecCc
Confidence 99763 68888888876322 34454 6 89999986 589999999983 34666778888888888888887
Q ss_pred c
Q 000080 2377 L 2377 (2389)
Q Consensus 2377 ~ 2377 (2389)
-
T Consensus 351 ~ 351 (406)
T KOG2919|consen 351 I 351 (406)
T ss_pred c
Confidence 5
No 185
>PRK03629 tolB translocation protein TolB; Provisional
Probab=98.53 E-value=8.8e-07 Score=110.77 Aligned_cols=142 Identities=11% Similarity=0.054 Sum_probs=97.5
Q ss_pred eEEEEEEcCCCCeEEEEe---CCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEE-eCCC--c
Q 000080 2221 STRAFSSHPLRPFFLVGS---SNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASA-ALDG--T 2294 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS---~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASg-S~Dg--T 2294 (2389)
.+.+.+|||||+.||..+ .+..|++||+.+|+...... ++ +| +.+++|||||++||.. +.+| .
T Consensus 200 ~~~~p~wSPDG~~la~~s~~~g~~~i~i~dl~~G~~~~l~~-~~-------~~---~~~~~~SPDG~~La~~~~~~g~~~ 268 (429)
T PRK03629 200 PLMSPAWSPDGSKLAYVTFESGRSALVIQTLANGAVRQVAS-FP-------RH---NGAPAFSPDGSKLAFALSKTGSLN 268 (429)
T ss_pred ceeeeEEcCCCCEEEEEEecCCCcEEEEEECCCCCeEEccC-CC-------CC---cCCeEECCCCCEEEEEEcCCCCcE
Confidence 457889999999988654 35689999998886533211 12 22 4568999999999865 4455 4
Q ss_pred EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080 2295 VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus 2295 VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
|.+||++++. ...+..+...+...+|+| ||+.|+.++ ..++..+||.+... +...+.+..+.....+.++
T Consensus 269 I~~~d~~tg~------~~~lt~~~~~~~~~~wSP-DG~~I~f~s--~~~g~~~Iy~~d~~-~g~~~~lt~~~~~~~~~~~ 338 (429)
T PRK03629 269 LYVMDLASGQ------IRQVTDGRSNNTEPTWFP-DSQNLAYTS--DQAGRPQVYKVNIN-GGAPQRITWEGSQNQDADV 338 (429)
T ss_pred EEEEECCCCC------EEEccCCCCCcCceEECC-CCCEEEEEe--CCCCCceEEEEECC-CCCeEEeecCCCCccCEEE
Confidence 8889998762 233344445677899999 999998753 24456677754322 3345566655556678899
Q ss_pred cccchhhhc
Q 000080 2375 LKLLNFALS 2383 (2389)
Q Consensus 2375 ~~~~~~~~s 2383 (2389)
+|+|++++-
T Consensus 339 SpDG~~Ia~ 347 (429)
T PRK03629 339 SSDGKFMVM 347 (429)
T ss_pred CCCCCEEEE
Confidence 999998753
No 186
>KOG4378 consensus Nuclear protein COP1 [Signal transduction mechanisms]
Probab=98.52 E-value=7.3e-07 Score=109.32 Aligned_cols=137 Identities=12% Similarity=0.190 Sum_probs=108.4
Q ss_pred eEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCc-eeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEE
Q 000080 2221 STRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDK-ATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCT 2297 (2389)
Q Consensus 2221 ~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk-~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkL 2297 (2389)
.||-+.|||..+ +|.++|+||+|.|||+ +|. .+..+. . .|.+.-+.|+|||-. ..|+|.+.|..|.+
T Consensus 166 svRll~ys~skr~lL~~asd~G~VtlwDv-~g~sp~~~~~--~-------~HsAP~~gicfspsne~l~vsVG~Dkki~~ 235 (673)
T KOG4378|consen 166 SVRLLRYSPSKRFLLSIASDKGAVTLWDV-QGMSPIFHAS--E-------AHSAPCRGICFSPSNEALLVSVGYDKKINI 235 (673)
T ss_pred eEEEeecccccceeeEeeccCCeEEEEec-cCCCcccchh--h-------hccCCcCcceecCCccceEEEecccceEEE
Confidence 468889999988 4677999999999998 454 443332 2 366788999999986 79999999999999
Q ss_pred eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080 2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus 2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
+|++.. + ....+ .-+.+..+|||++ +|.+|+.| +..|-|.-+|+. .+...+..+..|.+.|++||+.+.
T Consensus 236 yD~~s~-~----s~~~l-~y~~Plstvaf~~-~G~~L~aG---~s~G~~i~YD~R-~~k~Pv~v~sah~~sVt~vafq~s 304 (673)
T KOG4378|consen 236 YDIRSQ-A----STDRL-TYSHPLSTVAFSE-CGTYLCAG---NSKGELIAYDMR-STKAPVAVRSAHDASVTRVAFQPS 304 (673)
T ss_pred eecccc-c----cccee-eecCCcceeeecC-CceEEEee---cCCceEEEEecc-cCCCCceEeeecccceeEEEeeec
Confidence 999864 2 22222 2456778999999 99999864 577889999985 445669999999999999999886
Q ss_pred c
Q 000080 2378 L 2378 (2389)
Q Consensus 2378 ~ 2378 (2389)
-
T Consensus 305 ~ 305 (673)
T KOG4378|consen 305 P 305 (673)
T ss_pred c
Confidence 4
No 187
>KOG2394 consensus WD40 protein DMR-N9 [General function prediction only]
Probab=98.52 E-value=5.4e-07 Score=111.58 Aligned_cols=150 Identities=19% Similarity=0.226 Sum_probs=105.7
Q ss_pred CCCcCceeEEEEEEcCCCC-eEEEEeCCCcEEEeecC--------------CCcee--eEecccCCCCCC----CCCCCC
Q 000080 2214 PATVENISTRAFSSHPLRP-FFLVGSSNTHIYLWEFG--------------KDKAT--ATYGVLPAANVP----PPYALA 2272 (2389)
Q Consensus 2214 ~atv~ni~VrsVAFsPdG~-~LASGS~DgTIRLWDl~--------------tGk~l--~Tl~vl~gh~~p----~~GH~~ 2272 (2389)
.+.++.-+|.+|.|=|.+. .++.+-.+|.++++|.. .|... .+-..-...| | ..+ .+
T Consensus 214 ~r~i~ktsvT~ikWvpg~~~~Fl~a~~sGnlyly~~~~~~~~t~p~~~~~k~~~~f~i~t~ksk~~rN-Pv~~w~~~-~g 291 (636)
T KOG2394|consen 214 ERLINKSSVTCIKWVPGSDSLFLVAHASGNLYLYDKEIVCGATAPSYQALKDGDQFAILTSKSKKTRN-PVARWHIG-EG 291 (636)
T ss_pred cccccccceEEEEEEeCCCceEEEEEecCceEEeeccccccCCCCcccccCCCCeeEEeeeeccccCC-ccceeEec-cc
Confidence 3455555789999999665 45556789999999753 11100 0000000000 1 011 24
Q ss_pred CEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080 2273 SISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2273 ~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
.|...+|||||+.||+.|.||.+||.|..+.. .+-.++++- +...+|+||| ||++||||| +|-.|.||.+
T Consensus 292 ~in~f~FS~DG~~LA~VSqDGfLRvF~fdt~e--Llg~mkSYF---GGLLCvcWSP-DGKyIvtGG---EDDLVtVwSf- 361 (636)
T KOG2394|consen 292 SINEFAFSPDGKYLATVSQDGFLRIFDFDTQE--LLGVMKSYF---GGLLCVCWSP-DGKYIVTGG---EDDLVTVWSF- 361 (636)
T ss_pred cccceeEcCCCceEEEEecCceEEEeeccHHH--HHHHHHhhc---cceEEEEEcC-CccEEEecC---CcceEEEEEe-
Confidence 68889999999999999999999999998742 111222222 4677899999 999999975 9999999998
Q ss_pred CCCCCceEEEEeecCcEEEEeecc
Q 000080 2353 APPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus 2353 ~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
+..+.|..=+||..||..|||.|
T Consensus 362 -~erRVVARGqGHkSWVs~VaFDp 384 (636)
T KOG2394|consen 362 -EERRVVARGQGHKSWVSVVAFDP 384 (636)
T ss_pred -ccceEEEeccccccceeeEeecc
Confidence 45666888999999999999985
No 188
>KOG1188 consensus WD40 repeat protein [General function prediction only]
Probab=98.51 E-value=3.6e-07 Score=108.87 Aligned_cols=133 Identities=17% Similarity=0.162 Sum_probs=97.9
Q ss_pred CeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECC--CCCEEEEEeCCCcEEEeeCCCCCccCcc
Q 000080 2232 PFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDH--YGHRFASAALDGTVCTWQLEVGGRSNVR 2309 (2389)
Q Consensus 2232 ~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSP--DG~~LASgS~DgTVkLWDl~tggrs~~k 2309 (2389)
..+|+|=..|+|||+|..+|+.+..|.+ |.+.+..|+|.. .++.+.||+.|||||+||+++.++ .
T Consensus 41 ~~vav~lSngsv~lyd~~tg~~l~~fk~----------~~~~~N~vrf~~~ds~h~v~s~ssDG~Vr~wD~Rs~~e---~ 107 (376)
T KOG1188|consen 41 TAVAVSLSNGSVRLYDKGTGQLLEEFKG----------PPATTNGVRFISCDSPHGVISCSSDGTVRLWDIRSQAE---S 107 (376)
T ss_pred eeEEEEecCCeEEEEeccchhhhheecC----------CCCcccceEEecCCCCCeeEEeccCCeEEEEEeecchh---h
Confidence 4588888999999999999998888863 234467888876 468899999999999999998643 4
Q ss_pred cceeeeecCC-CeeEEEEecCCCCEEEEeec-CCCCCeEEEeeCCCCCCCceE-EEEeecCcEEEEeecccch
Q 000080 2310 PMESCLCFSS-HAMDVSYITSSGSVIAAAGH-SSNGINVVVWDTLAPPTSSRA-SITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus 2310 ~l~tl~gHs~-~V~sVAFSP~DGslLASAG~-sS~D~TVrLWD~l~~tg~~v~-sL~GH~~~V~svA~~~~~~ 2379 (2389)
+.....+|++ .-.+++-+- .++++|+|-- .-.|..|.+||+... .+.+. -.+.|.+.|++|-|+|+-.
T Consensus 108 a~~~~~~~~~~~f~~ld~nc-k~~ii~~GtE~~~s~A~v~lwDvR~~-qq~l~~~~eSH~DDVT~lrFHP~~p 178 (376)
T KOG1188|consen 108 ARISWTQQSGTPFICLDLNC-KKNIIACGTELTRSDASVVLWDVRSE-QQLLRQLNESHNDDVTQLRFHPSDP 178 (376)
T ss_pred hheeccCCCCCcceEeeccC-cCCeEEeccccccCceEEEEEEeccc-cchhhhhhhhccCcceeEEecCCCC
Confidence 5666677773 333455443 5678886410 115778999999532 23244 4588999999999999754
No 189
>KOG0307 consensus Vesicle coat complex COPII, subunit SEC31 [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.49 E-value=2.7e-07 Score=121.52 Aligned_cols=168 Identities=12% Similarity=0.163 Sum_probs=130.5
Q ss_pred ccccceeeccccccccccccccCCCCcCc------eeEEEEEEcCC-CCeEEEEeCCCcEEEeecCCCceeeEecccCCC
Q 000080 2191 YAGIGASALGWETQDDFEDYVDPPATVEN------ISTRAFSSHPL-RPFFLVGSSNTHIYLWEFGKDKATATYGVLPAA 2263 (2389)
Q Consensus 2191 ~~~~~Asg~~~d~~~~~~~~~d~~atv~n------i~VrsVAFsPd-G~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh 2263 (2389)
++-.+||| +.|..+=+|+...+...... -.|..|+|+.. ..+||||+.+|.+-+||++..+.+..+. .+
T Consensus 128 q~nlLASG-a~~geI~iWDlnn~~tP~~~~~~~~~~eI~~lsWNrkvqhILAS~s~sg~~~iWDlr~~~pii~ls---~~ 203 (1049)
T KOG0307|consen 128 QGNLLASG-ADDGEILIWDLNKPETPFTPGSQAPPSEIKCLSWNRKVSHILASGSPSGRAVIWDLRKKKPIIKLS---DT 203 (1049)
T ss_pred CCceeecc-CCCCcEEEeccCCcCCCCCCCCCCCcccceEeccchhhhHHhhccCCCCCceeccccCCCcccccc---cC
Confidence 44568888 88888889988754332211 14588999985 5589999999999999999887766553 22
Q ss_pred CCCCCCCCCCEEEEEECCCC-CEEEEEeCC---CcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeec
Q 000080 2264 NVPPPYALASISALQFDHYG-HRFASAALD---GTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGH 2339 (2389)
Q Consensus 2264 ~~p~~GH~~~V~sVaFSPDG-~~LASgS~D---gTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~ 2339 (2389)
+..-.+..|+++||+ .+++++++| -.|++||++... .|++.+++|+..|.++.|.+.|.++|+|.|
T Consensus 204 -----~~~~~~S~l~WhP~~aTql~~As~dd~~PviqlWDlR~as----sP~k~~~~H~~GilslsWc~~D~~lllSsg- 273 (1049)
T KOG0307|consen 204 -----PGRMHCSVLAWHPDHATQLLVASGDDSAPVIQLWDLRFAS----SPLKILEGHQRGILSLSWCPQDPRLLLSSG- 273 (1049)
T ss_pred -----CCccceeeeeeCCCCceeeeeecCCCCCceeEeecccccC----CchhhhcccccceeeeccCCCCchhhhccc-
Confidence 111348899999998 688888877 469999998752 688889999999999999998879999975
Q ss_pred CCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080 2340 SSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus 2340 sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
.|+.|-+|+. .+++.+..|....+|+.-|-+.|
T Consensus 274 --kD~~ii~wN~--~tgEvl~~~p~~~nW~fdv~w~p 306 (1049)
T KOG0307|consen 274 --KDNRIICWNP--NTGEVLGELPAQGNWCFDVQWCP 306 (1049)
T ss_pred --CCCCeeEecC--CCceEeeecCCCCcceeeeeecC
Confidence 8999999998 46777888877777777665544
No 190
>KOG1538 consensus Uncharacterized conserved protein WDR10, contains WD40 repeats [General function prediction only]
Probab=98.48 E-value=8e-07 Score=111.13 Aligned_cols=139 Identities=12% Similarity=0.132 Sum_probs=100.3
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.|..|+|-|||..|+-+..| .+.++|...|.+++|++ ||.+.|++||+|.||++||||+.|..|-+|.-
T Consensus 14 ci~d~afkPDGsqL~lAAg~-rlliyD~ndG~llqtLK----------gHKDtVycVAys~dGkrFASG~aDK~VI~W~~ 82 (1081)
T KOG1538|consen 14 CINDIAFKPDGTQLILAAGS-RLLVYDTSDGTLLQPLK----------GHKDTVYCVAYAKDGKRFASGSADKSVIIWTS 82 (1081)
T ss_pred chheeEECCCCceEEEecCC-EEEEEeCCCcccccccc----------cccceEEEEEEccCCceeccCCCceeEEEecc
Confidence 34777999999988776544 69999999999999985 57899999999999999999999999999976
Q ss_pred CCCCc---cC---ccc---------cee--e-------------ee--cCCCeeEEEEecCCCCEEEEeecCCCCCeEEE
Q 000080 2301 EVGGR---SN---VRP---------MES--C-------------LC--FSSHAMDVSYITSSGSVIAAAGHSSNGINVVV 2348 (2389)
Q Consensus 2301 ~tggr---s~---~k~---------l~t--l-------------~g--Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrL 2348 (2389)
...|- |+ +++ +.+ + +- -+..|.+.+|.. ||+++|-| -.||||.|
T Consensus 83 klEG~LkYSH~D~IQCMsFNP~~h~LasCsLsdFglWS~~qK~V~K~kss~R~~~CsWtn-DGqylalG---~~nGTIsi 158 (1081)
T KOG1538|consen 83 KLEGILKYSHNDAIQCMSFNPITHQLASCSLSDFGLWSPEQKSVSKHKSSSRIICCSWTN-DGQYLALG---MFNGTISI 158 (1081)
T ss_pred cccceeeeccCCeeeEeecCchHHHhhhcchhhccccChhhhhHHhhhhheeEEEeeecC-CCcEEEEe---ccCceEEe
Confidence 54331 00 000 000 0 00 124566788887 99999974 37899998
Q ss_pred eeCCCCCCCc---eEEEEeecCcEEEEeeccc
Q 000080 2349 WDTLAPPTSS---RASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus 2349 WD~l~~tg~~---v~sL~GH~~~V~svA~~~~ 2377 (2389)
=+- +++. ++.--|...+|++++..|.
T Consensus 159 RNk---~gEek~~I~Rpgg~Nspiwsi~~~p~ 187 (1081)
T KOG1538|consen 159 RNK---NGEEKVKIERPGGSNSPIWSICWNPS 187 (1081)
T ss_pred ecC---CCCcceEEeCCCCCCCCceEEEecCC
Confidence 874 3433 2333346677888887764
No 191
>KOG1408 consensus WD40 repeat protein [Function unknown]
Probab=98.48 E-value=1e-06 Score=111.08 Aligned_cols=117 Identities=13% Similarity=0.217 Sum_probs=106.2
Q ss_pred ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080 2219 NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus 2219 ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
...++.++..|+.++++++.+|..|||+|+++|+++++|++. .+|.+..-.|...|.|.++|+...|+|+.+.
T Consensus 596 ktTlYDm~Vdp~~k~v~t~cQDrnirif~i~sgKq~k~FKgs-------~~~eG~lIKv~lDPSgiY~atScsdktl~~~ 668 (1080)
T KOG1408|consen 596 KTTLYDMAVDPTSKLVVTVCQDRNIRIFDIESGKQVKSFKGS-------RDHEGDLIKVILDPSGIYLATSCSDKTLCFV 668 (1080)
T ss_pred cceEEEeeeCCCcceEEEEecccceEEEeccccceeeeeccc-------ccCCCceEEEEECCCccEEEEeecCCceEEE
Confidence 345689999999999999999999999999999999999753 2567888999999999999999999999999
Q ss_pred eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
|.-+| .++.+..||+-.|..+-|.+ |-+.|.|+ |.|+-|-||.+
T Consensus 669 Df~sg-----EcvA~m~GHsE~VTG~kF~n-DCkHlISv---sgDgCIFvW~l 712 (1080)
T KOG1408|consen 669 DFVSG-----ECVAQMTGHSEAVTGVKFLN-DCKHLISV---SGDGCIFVWKL 712 (1080)
T ss_pred Eeccc-----hhhhhhcCcchheeeeeecc-cchhheee---cCCceEEEEEC
Confidence 99997 47888899999999999999 88888887 58999999997
No 192
>PRK04922 tolB translocation protein TolB; Provisional
Probab=98.47 E-value=1.1e-06 Score=109.74 Aligned_cols=140 Identities=13% Similarity=0.061 Sum_probs=94.7
Q ss_pred EEEEEEcCCCCeEEEEeCC---CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEE-EEeCCC--cE
Q 000080 2222 TRAFSSHPLRPFFLVGSSN---THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFA-SAALDG--TV 2295 (2389)
Q Consensus 2222 VrsVAFsPdG~~LASGS~D---gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LA-SgS~Dg--TV 2295 (2389)
+.+.+|+|||+.|+..+.+ ..|++||+.+|+.... ... .+.+.+++|||||++|| +.+.+| .|
T Consensus 206 v~~p~wSpDg~~la~~s~~~~~~~l~~~dl~~g~~~~l-~~~----------~g~~~~~~~SpDG~~l~~~~s~~g~~~I 274 (433)
T PRK04922 206 ILSPAWSPDGKKLAYVSFERGRSAIYVQDLATGQRELV-ASF----------RGINGAPSFSPDGRRLALTLSRDGNPEI 274 (433)
T ss_pred cccccCCCCCCEEEEEecCCCCcEEEEEECCCCCEEEe-ccC----------CCCccCceECCCCCEEEEEEeCCCCceE
Confidence 4677999999999988743 4799999988875432 111 12345789999999886 445555 59
Q ss_pred EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeec
Q 000080 2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPL 2375 (2389)
Q Consensus 2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~ 2375 (2389)
.+||++++. ...+..|.....+++|+| ||+.|+.++ ..++..+||.+...+++ .+.+..+.......+.+
T Consensus 275 y~~d~~~g~------~~~lt~~~~~~~~~~~sp-DG~~l~f~s--d~~g~~~iy~~dl~~g~-~~~lt~~g~~~~~~~~S 344 (433)
T PRK04922 275 YVMDLGSRQ------LTRLTNHFGIDTEPTWAP-DGKSIYFTS--DRGGRPQIYRVAASGGS-AERLTFQGNYNARASVS 344 (433)
T ss_pred EEEECCCCC------eEECccCCCCccceEECC-CCCEEEEEE--CCCCCceEEEEECCCCC-eEEeecCCCCccCEEEC
Confidence 999998762 344555665667899999 999988753 24455455544223333 44444344445578999
Q ss_pred ccchhhh
Q 000080 2376 KLLNFAL 2382 (2389)
Q Consensus 2376 ~~~~~~~ 2382 (2389)
|+|+++.
T Consensus 345 pDG~~Ia 351 (433)
T PRK04922 345 PDGKKIA 351 (433)
T ss_pred CCCCEEE
Confidence 9998865
No 193
>KOG4547 consensus WD40 repeat-containing protein [General function prediction only]
Probab=98.47 E-value=8.7e-07 Score=111.15 Aligned_cols=105 Identities=11% Similarity=-0.006 Sum_probs=92.4
Q ss_pred CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080 2267 PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus 2267 ~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
..+|-+.|.++..+.+-..|=|++.|+.|..|+...+ +.++.+.+-...+.+++++| ||..|++|+ ++|
T Consensus 98 t~~h~~~v~~~~~~~~~~ciyS~~ad~~v~~~~~~~~-----~~~~~~~~~~~~~~sl~is~-D~~~l~~as-----~~i 166 (541)
T KOG4547|consen 98 TDKHYGNVNEILDAQRLGCIYSVGADLKVVYILEKEK-----VIIRIWKEQKPLVSSLCISP-DGKILLTAS-----RQI 166 (541)
T ss_pred cCCCCCcceeeecccccCceEecCCceeEEEEecccc-----eeeeeeccCCCccceEEEcC-CCCEEEecc-----ceE
Confidence 4678888999999999899999999999999999875 45667778888899999999 899999974 899
Q ss_pred EEeeCCCCCCCceEEEEeecCcEEEEeeccc-----chhhhcc
Q 000080 2347 VVWDTLAPPTSSRASITCHEGLYDLFLPLKL-----LNFALSK 2384 (2389)
Q Consensus 2347 rLWD~l~~tg~~v~sL~GH~~~V~svA~~~~-----~~~~~s~ 2384 (2389)
++||+ .+++-+++|.||.+.|+++++-++ |.+.||-
T Consensus 167 k~~~~--~~kevv~~ftgh~s~v~t~~f~~~~~g~~G~~vLss 207 (541)
T KOG4547|consen 167 KVLDI--ETKEVVITFTGHGSPVRTLSFTTLIDGIIGKYVLSS 207 (541)
T ss_pred EEEEc--cCceEEEEecCCCcceEEEEEEEeccccccceeeec
Confidence 99998 577889999999999999999998 8887764
No 194
>PRK01742 tolB translocation protein TolB; Provisional
Probab=98.46 E-value=5.6e-07 Score=112.23 Aligned_cols=124 Identities=13% Similarity=0.073 Sum_probs=90.8
Q ss_pred eCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC---CcEEEeeCCCCCccCcccceee
Q 000080 2238 SSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD---GTVCTWQLEVGGRSNVRPMESC 2314 (2389)
Q Consensus 2238 S~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D---gTVkLWDl~tggrs~~k~l~tl 2314 (2389)
+.+.+|++||. +|...+.+. +|...|.+++|||||++||.++.+ .+|.+||++++.+ +.+..+
T Consensus 181 ~~~~~i~i~d~-dg~~~~~lt----------~~~~~v~~p~wSPDG~~la~~s~~~~~~~i~i~dl~tg~~---~~l~~~ 246 (429)
T PRK01742 181 SQPYEVRVADY-DGFNQFIVN----------RSSQPLMSPAWSPDGSKLAYVSFENKKSQLVVHDLRSGAR---KVVASF 246 (429)
T ss_pred CceEEEEEECC-CCCCceEec----------cCCCccccceEcCCCCEEEEEEecCCCcEEEEEeCCCCce---EEEecC
Confidence 34689999998 455455542 244679999999999999998765 3799999988631 334444
Q ss_pred eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhh
Q 000080 2315 LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus 2315 ~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
.+|. .+++|+| ||+.||.++ +.|+.++||.+... +..+..+..|...+.+.+++|+|++++
T Consensus 247 ~g~~---~~~~wSP-DG~~La~~~--~~~g~~~Iy~~d~~-~~~~~~lt~~~~~~~~~~wSpDG~~i~ 307 (429)
T PRK01742 247 RGHN---GAPAFSP-DGSRLAFAS--SKDGVLNIYVMGAN-GGTPSQLTSGAGNNTEPSWSPDGQSIL 307 (429)
T ss_pred CCcc---CceeECC-CCCEEEEEE--ecCCcEEEEEEECC-CCCeEeeccCCCCcCCEEECCCCCEEE
Confidence 4443 4689999 999999863 46787777754323 344677888888889999999999765
No 195
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=98.46 E-value=2.4e-06 Score=102.08 Aligned_cols=140 Identities=12% Similarity=0.166 Sum_probs=92.5
Q ss_pred EEEEEEcCCCCeEEEEeC-CCcEEEeecCC--Cc--eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe-CCCcE
Q 000080 2222 TRAFSSHPLRPFFLVGSS-NTHIYLWEFGK--DK--ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA-LDGTV 2295 (2389)
Q Consensus 2222 VrsVAFsPdG~~LASGS~-DgTIRLWDl~t--Gk--~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-~DgTV 2295 (2389)
.+.++|+|||++++++.. +++|.+||+.. |+ .+.++...|.+. . +..+...++|+|||+++.++. .+++|
T Consensus 177 p~~~~~~pdg~~lyv~~~~~~~v~v~~~~~~~~~~~~~~~~~~~p~~~---~-~~~~~~~i~~~pdg~~lyv~~~~~~~I 252 (330)
T PRK11028 177 PRHMVFHPNQQYAYCVNELNSSVDVWQLKDPHGEIECVQTLDMMPADF---S-DTRWAADIHITPDGRHLYACDRTASLI 252 (330)
T ss_pred CceEEECCCCCEEEEEecCCCEEEEEEEeCCCCCEEEEEEEecCCCcC---C-CCccceeEEECCCCCEEEEecCCCCeE
Confidence 478899999999887776 99999999973 33 344443222210 1 123456799999999888885 58999
Q ss_pred EEeeCCCCCccCcccceeeeecC---CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCc--eEEEEeecCcEE
Q 000080 2296 CTWQLEVGGRSNVRPMESCLCFS---SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSS--RASITCHEGLYD 2370 (2389)
Q Consensus 2296 kLWDl~tggrs~~k~l~tl~gHs---~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~--v~sL~GH~~~V~ 2370 (2389)
.+|+++..+ ...++.+|. ...+.++|+| ||++|++++ ..+++|.+|++...++.. ++++.. ..+-.
T Consensus 253 ~v~~i~~~~-----~~~~~~~~~~~~~~p~~~~~~~-dg~~l~va~--~~~~~v~v~~~~~~~g~l~~~~~~~~-g~~P~ 323 (330)
T PRK11028 253 SVFSVSEDG-----SVLSFEGHQPTETQPRGFNIDH-SGKYLIAAG--QKSHHISVYEIDGETGLLTELGRYAV-GQGPM 323 (330)
T ss_pred EEEEEeCCC-----CeEEEeEEEeccccCCceEECC-CCCEEEEEE--ccCCcEEEEEEcCCCCcEEEcccccc-CCCce
Confidence 999997542 111222332 2456799999 999999874 468999999874344432 344443 33444
Q ss_pred EEee
Q 000080 2371 LFLP 2374 (2389)
Q Consensus 2371 svA~ 2374 (2389)
|+++
T Consensus 324 ~~~~ 327 (330)
T PRK11028 324 WVSV 327 (330)
T ss_pred EEEE
Confidence 5554
No 196
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=98.45 E-value=2.3e-06 Score=104.73 Aligned_cols=139 Identities=14% Similarity=0.059 Sum_probs=97.0
Q ss_pred EEEEEEcCCCCeEEEEeCC---CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEE-EeCCC--cE
Q 000080 2222 TRAFSSHPLRPFFLVGSSN---THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFAS-AALDG--TV 2295 (2389)
Q Consensus 2222 VrsVAFsPdG~~LASGS~D---gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LAS-gS~Dg--TV 2295 (2389)
+.+.+|+|||++||.++.+ .+|++||+.+|+...... +...+.+++|+|||+.|+. .+.++ .|
T Consensus 192 ~~~p~~Spdg~~la~~~~~~~~~~i~v~d~~~g~~~~~~~-----------~~~~~~~~~~spDg~~l~~~~~~~~~~~i 260 (417)
T TIGR02800 192 ILSPAWSPDGQKLAYVSFESGKPEIYVQDLATGQREKVAS-----------FPGMNGAPAFSPDGSKLAVSLSKDGNPDI 260 (417)
T ss_pred eecccCCCCCCEEEEEEcCCCCcEEEEEECCCCCEEEeec-----------CCCCccceEECCCCCEEEEEECCCCCccE
Confidence 4677999999999987754 489999998886543221 1234677899999998874 44444 58
Q ss_pred EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCC--eEEEeeCCCCCCCceEEEEeecCcEEEEe
Q 000080 2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGI--NVVVWDTLAPPTSSRASITCHEGLYDLFL 2373 (2389)
Q Consensus 2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~--TVrLWD~l~~tg~~v~sL~GH~~~V~svA 2373 (2389)
.+||++++. ...+..|.......+|+| ||+.|+.++ ..++ .|.+||+ . +...+.+..+...+..++
T Consensus 261 ~~~d~~~~~------~~~l~~~~~~~~~~~~s~-dg~~l~~~s--~~~g~~~iy~~d~--~-~~~~~~l~~~~~~~~~~~ 328 (417)
T TIGR02800 261 YVMDLDGKQ------LTRLTNGPGIDTEPSWSP-DGKSIAFTS--DRGGSPQIYMMDA--D-GGEVRRLTFRGGYNASPS 328 (417)
T ss_pred EEEECCCCC------EEECCCCCCCCCCEEECC-CCCEEEEEE--CCCCCceEEEEEC--C-CCCEEEeecCCCCccCeE
Confidence 888998752 233444555556788999 999888753 2333 5666675 2 334566766777778889
Q ss_pred ecccchhhhc
Q 000080 2374 PLKLLNFALS 2383 (2389)
Q Consensus 2374 ~~~~~~~~~s 2383 (2389)
.+|+|++++-
T Consensus 329 ~spdg~~i~~ 338 (417)
T TIGR02800 329 WSPDGDLIAF 338 (417)
T ss_pred ECCCCCEEEE
Confidence 9999987664
No 197
>KOG2106 consensus Uncharacterized conserved protein, contains HELP and WD40 domains [Function unknown]
Probab=98.44 E-value=2.3e-06 Score=105.58 Aligned_cols=138 Identities=15% Similarity=0.193 Sum_probs=110.3
Q ss_pred EEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCC
Q 000080 2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus 2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~ 2301 (2389)
.+.++-||+.++++|+++|++++||+ ..+..-+-.. .+.+.++.|.|.| .+|.|...|..-+-|.+
T Consensus 371 lwgla~hps~~q~~T~gqdk~v~lW~--~~k~~wt~~~-----------~d~~~~~~fhpsg-~va~Gt~~G~w~V~d~e 436 (626)
T KOG2106|consen 371 LWGLATHPSKNQLLTCGQDKHVRLWN--DHKLEWTKII-----------EDPAECADFHPSG-VVAVGTATGRWFVLDTE 436 (626)
T ss_pred eeeEEcCCChhheeeccCcceEEEcc--CCceeEEEEe-----------cCceeEeeccCcc-eEEEeeccceEEEEecc
Confidence 47889999999999999999999999 4455444321 2668999999999 99999999999999999
Q ss_pred CCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEE-EeecCcEEEEeecccchh
Q 000080 2302 VGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASI-TCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus 2302 tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL-~GH~~~V~svA~~~~~~~ 2380 (2389)
+. ..+....+ +.+++.|+|+| ||.+||.| |.|+.|.|+.+. +.+...... .+|-..|+-+..+.+++|
T Consensus 437 ~~-----~lv~~~~d-~~~ls~v~ysp-~G~~lAvg---s~d~~iyiy~Vs-~~g~~y~r~~k~~gs~ithLDwS~Ds~~ 505 (626)
T KOG2106|consen 437 TQ-----DLVTIHTD-NEQLSVVRYSP-DGAFLAVG---SHDNHIYIYRVS-ANGRKYSRVGKCSGSPITHLDWSSDSQF 505 (626)
T ss_pred cc-----eeEEEEec-CCceEEEEEcC-CCCEEEEe---cCCCeEEEEEEC-CCCcEEEEeeeecCceeEEeeecCCCce
Confidence 74 23444444 78899999999 99999986 799999999984 445443333 445578899999999988
Q ss_pred hhcc
Q 000080 2381 ALSK 2384 (2389)
Q Consensus 2381 ~~s~ 2384 (2389)
..+.
T Consensus 506 ~~~~ 509 (626)
T KOG2106|consen 506 LVSN 509 (626)
T ss_pred EEec
Confidence 7764
No 198
>KOG1524 consensus WD40 repeat-containing protein CHE-2 [General function prediction only]
Probab=98.40 E-value=5.1e-06 Score=102.90 Aligned_cols=211 Identities=16% Similarity=0.248 Sum_probs=133.2
Q ss_pred eEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEE-EecCCeEEEEeeCCCCCCC
Q 000080 54 SWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLA-AASENCIFVFAHDSASSKG 132 (2389)
Q Consensus 54 ~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIa-ASyDntIRVw~~d~~~~kg 132 (2389)
.|+.+.+.+.++|+. --.. -|. .++.|. ..|.+-+|+|| +.-|+ |+-|+.|++|... |
T Consensus 77 ~~~i~s~DGkf~il~--k~~r-VE~--------sv~AH~--~A~~~gRW~~d---GtgLlt~GEDG~iKiWSrs-----G 135 (737)
T KOG1524|consen 77 TLLICSNDGRFVILN--KSAR-VER--------SISAHA--AAISSGRWSPD---GAGLLTAGEDGVIKIWSRS-----G 135 (737)
T ss_pred eEEEEcCCceEEEec--ccch-hhh--------hhhhhh--hhhhhcccCCC---CceeeeecCCceEEEEecc-----c
Confidence 355566655666665 2111 121 234443 47999999998 44455 5669999999886 1
Q ss_pred CccceeeEEec-ccceEEEEeecCCCCeEEEEecc-eEEeeccCCcEEEEEEeeccccceEEEEeecCCCc-eEeeeccc
Q 000080 133 SFCWSQNAILV-QGTKVEAIEWTGSGDGIVAGGME-TVLWKKKNTLWEIAWKFKENYPQNLVSATWSIEGP-SATAASMS 209 (2389)
Q Consensus 133 d~~W~~~~tL~-hssTV~sIAWSpdG~rLaSggdD-V~IW~~~~s~Wecvwt~~~~~~~~ivsvaWSpdG~-fATag~di 209 (2389)
-. +.++. ....|++++|.|+++.++-|-.+ +-|=-....+-.+-|+ .|..-+.+++|++... +||+|.|.
T Consensus 136 ML----RStl~Q~~~~v~c~~W~p~S~~vl~c~g~h~~IKpL~~n~k~i~Wk---AHDGiiL~~~W~~~s~lI~sgGED~ 208 (737)
T KOG1524|consen 136 ML----RSTVVQNEESIRCARWAPNSNSIVFCQGGHISIKPLAANSKIIRWR---AHDGLVLSLSWSTQSNIIASGGEDF 208 (737)
T ss_pred hH----HHHHhhcCceeEEEEECCCCCceEEecCCeEEEeecccccceeEEe---ccCcEEEEeecCccccceeecCCce
Confidence 11 22333 36689999999999999965555 5443344445555564 4666677999999877 99999999
Q ss_pred ccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeecCCc
Q 000080 210 QLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMDSGK 289 (2389)
Q Consensus 210 kf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d~Gk 289 (2389)
||++| |+-....+.-.+|.-+|.+|+|+| | ...|-+|+ +|.|+=+
T Consensus 209 kfKvW--------------D~~G~~Lf~S~~~ey~ITSva~np--------d------~~~~v~S~-nt~R~~~------ 253 (737)
T KOG1524|consen 209 RFKIW--------------DAQGANLFTSAAEEYAITSVAFNP--------E------KDYLLWSY-NTARFSS------ 253 (737)
T ss_pred eEEee--------------cccCcccccCChhccceeeeeecc--------c------cceeeeee-eeeeecC------
Confidence 98877 333444566789999999999999 3 23555554 5666211
Q ss_pred ccccccccCCCCccceeEEEEEEEeecccccCCCCCCeEEEeeccccce
Q 000080 290 TRKVAKDTNDHKTIRRSFCVGAIIEINQALNGALGMDIVITWAKEIRCM 338 (2389)
Q Consensus 290 ~kk~~~~~~d~~~~~~sF~vaA~I~~~~~~~~~l~~~~~v~W~~~~~~v 338 (2389)
.+++--|-++=++.=-|..-||--+-+++--+.++..+
T Consensus 254 -----------p~~GSifnlsWS~DGTQ~a~gt~~G~v~~A~~ieq~l~ 291 (737)
T KOG1524|consen 254 -----------PRVGSIFNLSWSADGTQATCGTSTGQLIVAYAIEQQLV 291 (737)
T ss_pred -----------CCccceEEEEEcCCCceeeccccCceEEEeeeehhhhh
Confidence 23455566666666334333333333444444444444
No 199
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=98.39 E-value=1.8e-06 Score=105.87 Aligned_cols=159 Identities=16% Similarity=0.167 Sum_probs=119.6
Q ss_pred cccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc---eeeEecccCCCCCCCCCCCCCEEEEEEC
Q 000080 2204 QDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK---ATATYGVLPAANVPPPYALASISALQFD 2280 (2389)
Q Consensus 2204 ~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk---~l~Tl~vl~gh~~p~~GH~~~V~sVaFS 2280 (2389)
..++.+++..-.+. -+|++|.|||..+.|++|+.|+++||+.+. |+ .++.+. + -.-.|.+..|.
T Consensus 200 ~krlkDaNa~~ps~--~~I~sv~FHp~~plllvaG~d~~lrifqvD-Gk~N~~lqS~~-l---------~~fPi~~a~f~ 266 (514)
T KOG2055|consen 200 IKRLKDANAAHPSH--GGITSVQFHPTAPLLLVAGLDGTLRIFQVD-GKVNPKLQSIH-L---------EKFPIQKAEFA 266 (514)
T ss_pred eEeecccccCCcCc--CCceEEEecCCCceEEEecCCCcEEEEEec-CccChhheeee-e---------ccCccceeeec
Confidence 44555554222222 245999999999999999999999999995 54 233332 1 12458999999
Q ss_pred CCCC-EEEEEeCCCcEEEeeCCCCCccCcccceeeeecC-CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCc
Q 000080 2281 HYGH-RFASAALDGTVCTWQLEVGGRSNVRPMESCLCFS-SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSS 2358 (2389)
Q Consensus 2281 PDG~-~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs-~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~ 2358 (2389)
|+|+ .+++++.-.-...||++++. ...+....|+. ..+..+..+| +|++||.+| ..|-|-|=-. .+++.
T Consensus 267 p~G~~~i~~s~rrky~ysyDle~ak---~~k~~~~~g~e~~~~e~FeVSh-d~~fia~~G---~~G~I~lLha--kT~el 337 (514)
T KOG2055|consen 267 PNGHSVIFTSGRRKYLYSYDLETAK---VTKLKPPYGVEEKSMERFEVSH-DSNFIAIAG---NNGHIHLLHA--KTKEL 337 (514)
T ss_pred CCCceEEEecccceEEEEeeccccc---cccccCCCCcccchhheeEecC-CCCeEEEcc---cCceEEeehh--hhhhh
Confidence 9998 99999999999999999873 23444444544 5567788999 999999997 6788888665 45666
Q ss_pred eEEEEeecCcEEEEeecccchhhhccc
Q 000080 2359 RASITCHEGLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus 2359 v~sL~GH~~~V~svA~~~~~~~~~s~~ 2385 (2389)
+.++. -++.|..++++.+|..++.-|
T Consensus 338 i~s~K-ieG~v~~~~fsSdsk~l~~~~ 363 (514)
T KOG2055|consen 338 ITSFK-IEGVVSDFTFSSDSKELLASG 363 (514)
T ss_pred hheee-eccEEeeEEEecCCcEEEEEc
Confidence 78887 678899999999998877654
No 200
>KOG1273 consensus WD40 repeat protein [General function prediction only]
Probab=98.37 E-value=1e-06 Score=104.11 Aligned_cols=92 Identities=15% Similarity=0.180 Sum_probs=78.1
Q ss_pred EEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCC
Q 000080 2274 ISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLA 2353 (2389)
Q Consensus 2274 V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~ 2353 (2389)
-.+++||+.|..||+|..||.|-+||+.|. .+-+.+.+|-.+|.+++||+ ||+.|.|+ |.|..|++||++.
T Consensus 26 a~~~~Fs~~G~~lAvGc~nG~vvI~D~~T~-----~iar~lsaH~~pi~sl~WS~-dgr~Llts---S~D~si~lwDl~~ 96 (405)
T KOG1273|consen 26 AECCQFSRWGDYLAVGCANGRVVIYDFDTF-----RIARMLSAHVRPITSLCWSR-DGRKLLTS---SRDWSIKLWDLLK 96 (405)
T ss_pred cceEEeccCcceeeeeccCCcEEEEEcccc-----chhhhhhccccceeEEEecC-CCCEeeee---cCCceeEEEeccC
Confidence 689999999999999999999999999985 36677899999999999999 99999997 7999999999963
Q ss_pred CCCCceEEEEeecCcEEEEeeccc
Q 000080 2354 PPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus 2354 ~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
|.+++.+. -..+|+....+|-
T Consensus 97 --gs~l~rir-f~spv~~~q~hp~ 117 (405)
T KOG1273|consen 97 --GSPLKRIR-FDSPVWGAQWHPR 117 (405)
T ss_pred --CCceeEEE-ccCccceeeeccc
Confidence 55777765 4556666555553
No 201
>KOG0974 consensus WD-repeat protein WDR6, WD repeat superfamily [General function prediction only]
Probab=98.37 E-value=1.9e-06 Score=113.02 Aligned_cols=135 Identities=13% Similarity=0.113 Sum_probs=105.0
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
.-+-++++-=++++|+.=+.|.+|++. +.....+ ..||.+.+.++.+|-||+++||.|+|+++|+|++++
T Consensus 137 ~~~g~s~~~~~i~~gsv~~~iivW~~~-~dn~p~~---------l~GHeG~iF~i~~s~dg~~i~s~SdDRsiRlW~i~s 206 (967)
T KOG0974|consen 137 LIIGDSAEELYIASGSVFGEIIVWKPH-EDNKPIR---------LKGHEGSIFSIVTSLDGRYIASVSDDRSIRLWPIDS 206 (967)
T ss_pred EEEeccCcEEEEEeccccccEEEEecc-ccCCcce---------ecccCCceEEEEEccCCcEEEEEecCcceeeeeccc
Confidence 455678888899999999999999986 3322221 247899999999999999999999999999999998
Q ss_pred CCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecC-cEEEEeecccchh
Q 000080 2303 GGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEG-LYDLFLPLKLLNF 2380 (2389)
Q Consensus 2303 ggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~-~V~svA~~~~~~~ 2380 (2389)
+. ..--+.-||+..|+.+.|.| + .|+|+| +|-|.|+|+. .++.+..+.+|.+ .++.++.++.--+
T Consensus 207 ~~----~~~~~~fgHsaRvw~~~~~~-n--~i~t~g---edctcrvW~~---~~~~l~~y~~h~g~~iw~~~~~~~~~~ 272 (967)
T KOG0974|consen 207 RE----VLGCTGFGHSARVWACCFLP-N--RIITVG---EDCTCRVWGV---NGTQLEVYDEHSGKGIWKIAVPIGVII 272 (967)
T ss_pred cc----ccCcccccccceeEEEEecc-c--eeEEec---cceEEEEEec---ccceehhhhhhhhcceeEEEEcCCceE
Confidence 63 22246678999999999999 4 899984 9999999986 3444556666653 4566666554333
No 202
>KOG0642 consensus Cell-cycle nuclear protein, contains WD-40 repeats [Cell cycle control, cell division, chromosome partitioning]
Probab=98.36 E-value=2.1e-06 Score=107.20 Aligned_cols=155 Identities=14% Similarity=0.113 Sum_probs=111.7
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc-eeeEe--cccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEE
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK-ATATY--GVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVC 2296 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk-~l~Tl--~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVk 2296 (2389)
.+|-+|+..+++..+.|||.||+||+|++.... .--++ .++.+ ...||++.|+.+++|+.-.+|+++|.|||||
T Consensus 345 gPVl~v~v~~n~~~~ysgg~Dg~I~~w~~p~n~dp~ds~dp~vl~~---~l~Ghtdavw~l~~s~~~~~Llscs~DgTvr 421 (577)
T KOG0642|consen 345 GPVLCVVVPSNGEHCYSGGIDGTIRCWNLPPNQDPDDSYDPSVLSG---TLLGHTDAVWLLALSSTKDRLLSCSSDGTVR 421 (577)
T ss_pred CceEEEEecCCceEEEeeccCceeeeeccCCCCCcccccCcchhcc---ceeccccceeeeeecccccceeeecCCceEE
Confidence 367899999999999999999999999654111 10111 01112 2468999999999999999999999999999
Q ss_pred EeeCCCCCc-------------------c--------------------Ccccceee--ee-----cCCCeeEEEEecCC
Q 000080 2297 TWQLEVGGR-------------------S--------------------NVRPMESC--LC-----FSSHAMDVSYITSS 2330 (2389)
Q Consensus 2297 LWDl~tggr-------------------s--------------------~~k~l~tl--~g-----Hs~~V~sVAFSP~D 2330 (2389)
+|+...... + ....+..+ .. -...++-|..+| .
T Consensus 422 ~w~~~~~~~~~f~~~~e~g~Plsvd~~ss~~a~~~~s~~~~~~~~~~~ev~s~~~~~~s~~~~~~~~~~~in~vVs~~-~ 500 (577)
T KOG0642|consen 422 LWEPTEESPCTFGEPKEHGYPLSVDRTSSRPAHSLASFRFGYTSIDDMEVVSDLLIFESSASPGPRRYPQINKVVSHP-T 500 (577)
T ss_pred eeccCCcCccccCCccccCCcceEeeccchhHhhhhhcccccccchhhhhhhheeeccccCCCcccccCccceEEecC-C
Confidence 997643210 0 00000000 00 013455566777 7
Q ss_pred CCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080 2331 GSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2331 GslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
+.+..++. +|+.||+.|. -+++.+++...|...++++|+.|.|-+..|
T Consensus 501 ~~~~~~~h---ed~~Ir~~dn--~~~~~l~s~~a~~~svtslai~~ng~~l~s 548 (577)
T KOG0642|consen 501 ADITFTAH---EDRSIRFFDN--KTGKILHSMVAHKDSVTSLAIDPNGPYLMS 548 (577)
T ss_pred CCeeEecc---cCCceecccc--cccccchheeeccceecceeecCCCceEEe
Confidence 77777764 9999999997 467889999999999999999999987665
No 203
>KOG0644 consensus Uncharacterized conserved protein, contains WD40 repeat and BROMO domains [General function prediction only]
Probab=98.35 E-value=1.9e-07 Score=119.17 Aligned_cols=99 Identities=23% Similarity=0.308 Sum_probs=90.3
Q ss_pred CCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080 2268 PYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus 2268 ~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
.||.+.|+|+.|.-.|+.+.+||+|.-||+|..+++ .++.++.||++.++++|.+. ...++|++ |.|..||
T Consensus 187 lgH~naVyca~fDrtg~~Iitgsdd~lvKiwS~et~-----~~lAs~rGhs~ditdlavs~-~n~~iaaa---S~D~vIr 257 (1113)
T KOG0644|consen 187 LGHRNAVYCAIFDRTGRYIITGSDDRLVKIWSMETA-----RCLASCRGHSGDITDLAVSS-NNTMIAAA---SNDKVIR 257 (1113)
T ss_pred HhhhhheeeeeeccccceEeecCccceeeeeeccch-----hhhccCCCCccccchhccch-hhhhhhhc---ccCceEE
Confidence 478899999999999999999999999999999886 57899999999999999998 66788875 7999999
Q ss_pred EeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080 2348 VWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus 2348 LWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
+|.. +.+..+.-|.||++.|+++|++|-
T Consensus 258 vWrl--~~~~pvsvLrghtgavtaiafsP~ 285 (1113)
T KOG0644|consen 258 VWRL--PDGAPVSVLRGHTGAVTAIAFSPR 285 (1113)
T ss_pred EEec--CCCchHHHHhccccceeeeccCcc
Confidence 9997 677778999999999999999884
No 204
>KOG4227 consensus WD40 repeat protein [General function prediction only]
Probab=98.34 E-value=3.6e-06 Score=101.00 Aligned_cols=138 Identities=13% Similarity=0.057 Sum_probs=102.9
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCC------ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCc
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKD------KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGT 2294 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tG------k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgT 2294 (2389)
.|.+|.|+-++++||||++|.++++|++..- +.+. +.+|. |..-|.+++|+.-.+++-||..|+|
T Consensus 58 CiNAlqFS~N~~~L~SGGDD~~~~~W~~de~~~~k~~KPI~----~~~~~-----H~SNIF~L~F~~~N~~~~SG~~~~~ 128 (609)
T KOG4227|consen 58 CINALQFSHNDRFLASGGDDMHGRVWNVDELMVRKTPKPIG----VMEHP-----HRSNIFSLEFDLENRFLYSGERWGT 128 (609)
T ss_pred ccceeeeccCCeEEeecCCcceeeeechHHHHhhcCCCCce----eccCc-----cccceEEEEEccCCeeEecCCCcce
Confidence 4689999999999999999999999998622 2222 23442 6688999999999999999999999
Q ss_pred EEEeeCCCCCccCcccceeeeecCC---CeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCC-CCceEEEEeecCcEE
Q 000080 2295 VCTWQLEVGGRSNVRPMESCLCFSS---HAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPP-TSSRASITCHEGLYD 2370 (2389)
Q Consensus 2295 VkLWDl~tggrs~~k~l~tl~gHs~---~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~t-g~~v~sL~GH~~~V~ 2370 (2389)
|-+-|+++.. .+. ...|.. .|+.+.-+| ..+++|+. +.|+.|-+||....+ ....-++........
T Consensus 129 VI~HDiEt~q-----si~-V~~~~~~~~~VY~m~~~P-~DN~~~~~---t~~~~V~~~D~Rd~~~~~~~~~~AN~~~~F~ 198 (609)
T KOG4227|consen 129 VIKHDIETKQ-----SIY-VANENNNRGDVYHMDQHP-TDNTLIVV---TRAKLVSFIDNRDRQNPISLVLPANSGKNFY 198 (609)
T ss_pred eEeeecccce-----eee-eecccCcccceeecccCC-CCceEEEE---ecCceEEEEeccCCCCCCceeeecCCCccce
Confidence 9999999852 222 234555 899999999 56778775 699999999985433 222444554555555
Q ss_pred EEeeccc
Q 000080 2371 LFLPLKL 2377 (2389)
Q Consensus 2371 svA~~~~ 2377 (2389)
++.++|-
T Consensus 199 t~~F~P~ 205 (609)
T KOG4227|consen 199 TAEFHPE 205 (609)
T ss_pred eeeecCC
Confidence 5555553
No 205
>KOG2110 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=98.33 E-value=4.8e-06 Score=100.35 Aligned_cols=112 Identities=20% Similarity=0.243 Sum_probs=87.2
Q ss_pred eEEEEEEcCCCCeEEE-Ee-CCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCc-EEE
Q 000080 2221 STRAFSSHPLRPFFLV-GS-SNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGT-VCT 2297 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LAS-GS-~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgT-VkL 2297 (2389)
++-++++|+.+.+||- || .-|.|.|||..+=+.+.++. + |.+.|.+++|||||++|||||+.|| ||+
T Consensus 131 gl~AlS~n~~n~ylAyp~s~t~GdV~l~d~~nl~~v~~I~---a-------H~~~lAalafs~~G~llATASeKGTVIRV 200 (391)
T KOG2110|consen 131 GLCALSPNNANCYLAYPGSTTSGDVVLFDTINLQPVNTIN---A-------HKGPLAALAFSPDGTLLATASEKGTVIRV 200 (391)
T ss_pred ceEeeccCCCCceEEecCCCCCceEEEEEcccceeeeEEE---e-------cCCceeEEEECCCCCEEEEeccCceEEEE
Confidence 4566666666678876 33 56899999998777777763 3 6789999999999999999999999 589
Q ss_pred eeCCCCCccCcccceeeeec--CCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2298 WQLEVGGRSNVRPMESCLCF--SSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2298 WDl~tggrs~~k~l~tl~gH--s~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
..+..|. .++.++-- --.|++++|+| |+++|+++ |+-+||.|+.+
T Consensus 201 f~v~~G~-----kl~eFRRG~~~~~IySL~Fs~-ds~~L~~s---S~TeTVHiFKL 247 (391)
T KOG2110|consen 201 FSVPEGQ-----KLYEFRRGTYPVSIYSLSFSP-DSQFLAAS---SNTETVHIFKL 247 (391)
T ss_pred EEcCCcc-----EeeeeeCCceeeEEEEEEECC-CCCeEEEe---cCCCeEEEEEe
Confidence 9998873 22332211 24577999999 99999986 57889999987
No 206
>KOG1538 consensus Uncharacterized conserved protein WDR10, contains WD40 repeats [General function prediction only]
Probab=98.31 E-value=1.6e-05 Score=99.96 Aligned_cols=193 Identities=16% Similarity=0.305 Sum_probs=131.0
Q ss_pred CCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEEe--cC
Q 000080 40 STSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAAA--SE 117 (2389)
Q Consensus 40 ~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaAS--yD 117 (2389)
...-+++.|| | +-+.-|+|+-+.++.. ..+ ..+ |.+.||.| -|-||||+-| |+..|| +|
T Consensus 14 ci~d~afkPD--G-sqL~lAAg~rlliyD~---ndG-~ll------qtLKgHKD--tVycVAys~d----GkrFASG~aD 74 (1081)
T KOG1538|consen 14 CINDIAFKPD--G-TQLILAAGSRLLVYDT---SDG-TLL------QPLKGHKD--TVYCVAYAKD----GKRFASGSAD 74 (1081)
T ss_pred chheeEECCC--C-ceEEEecCCEEEEEeC---CCc-ccc------cccccccc--eEEEEEEccC----CceeccCCCc
Confidence 5677899999 7 4677899999999972 223 345 89999999 8999999997 777764 58
Q ss_pred CeEEEEeeCCCCCCCCccceeeEEe--cccceEEEEeecCCCCeEEEEec-ceEEeeccCCcEEEEEEeeccccceEEEE
Q 000080 118 NCIFVFAHDSASSKGSFCWSQNAIL--VQGTKVEAIEWTGSGDGIVAGGM-ETVLWKKKNTLWEIAWKFKENYPQNLVSA 194 (2389)
Q Consensus 118 ntIRVw~~d~~~~kgd~~W~~~~tL--~hssTV~sIAWSpdG~rLaSggd-DV~IW~~~~s~Wecvwt~~~~~~~~ivsv 194 (2389)
+.|-||.+.- .| +| .|+..|.+++|+|....|+||+- |-.+|...... | .+.....-+.+.
T Consensus 75 K~VI~W~~kl---EG--------~LkYSH~D~IQCMsFNP~~h~LasCsLsdFglWS~~qK~---V--~K~kss~R~~~C 138 (1081)
T KOG1538|consen 75 KSVIIWTSKL---EG--------ILKYSHNDAIQCMSFNPITHQLASCSLSDFGLWSPEQKS---V--SKHKSSSRIICC 138 (1081)
T ss_pred eeEEEecccc---cc--------eeeeccCCeeeEeecCchHHHhhhcchhhccccChhhhh---H--HhhhhheeEEEe
Confidence 9999998751 12 22 38889999999999999999998 59999743211 1 111122235578
Q ss_pred eecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccCceEEee
Q 000080 195 TWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTC 273 (2389)
Q Consensus 195 aWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILASc 273 (2389)
+|.-||. ||-+-++....+.+... .+.+-|. -..+-..+|.+|+|+|.+ + ....++++-.
T Consensus 139 sWtnDGqylalG~~nGTIsiRNk~g-Eek~~I~----------Rpgg~Nspiwsi~~~p~s-----g---~G~~di~aV~ 199 (1081)
T KOG1538|consen 139 SWTNDGQYLALGMFNGTISIRNKNG-EEKVKIE----------RPGGSNSPIWSICWNPSS-----G---EGRNDILAVA 199 (1081)
T ss_pred eecCCCcEEEEeccCceEEeecCCC-CcceEEe----------CCCCCCCCceEEEecCCC-----C---CCccceEEEE
Confidence 9999999 88876644422221100 0111111 123455899999999942 2 2345777777
Q ss_pred ecCCeEEEEEeec
Q 000080 274 CLDGTVRLWCEMD 286 (2389)
Q Consensus 274 SdDgTVRLW~e~d 286 (2389)
--..|.-.+...+
T Consensus 200 DW~qTLSFy~LsG 212 (1081)
T KOG1538|consen 200 DWGQTLSFYQLSG 212 (1081)
T ss_pred eccceeEEEEecc
Confidence 7777777777654
No 207
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=98.31 E-value=8.5e-06 Score=103.49 Aligned_cols=145 Identities=11% Similarity=0.113 Sum_probs=116.7
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.|+++||+.+.+.||.|=.||.|.||++..+.+.... ++|+ ....|.+++|+ +|.+|-|.+.+|+|.-||+
T Consensus 27 ~I~slA~s~kS~~lAvsRt~g~IEiwN~~~~w~~~~v--i~g~------~drsIE~L~W~-e~~RLFS~g~sg~i~EwDl 97 (691)
T KOG2048|consen 27 EIVSLAYSHKSNQLAVSRTDGNIEIWNLSNNWFLEPV--IHGP------EDRSIESLAWA-EGGRLFSSGLSGSITEWDL 97 (691)
T ss_pred ceEEEEEeccCCceeeeccCCcEEEEccCCCceeeEE--EecC------CCCceeeEEEc-cCCeEEeecCCceEEEEec
Confidence 4699999999999999999999999999999865543 2332 34679999999 6668889999999999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCce--EEEEeecCcEEEEeecccc
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSR--ASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v--~sL~GH~~~V~svA~~~~~ 2378 (2389)
.++ ++.+.+.+..+.++++|.+| .++.+|-+ ++||.+..-+. .++... ..|.-.+++|-+|+.+|+|
T Consensus 98 ~~l-----k~~~~~d~~gg~IWsiai~p-~~~~l~Ig---cddGvl~~~s~--~p~~I~~~r~l~rq~sRvLslsw~~~~ 166 (691)
T KOG2048|consen 98 HTL-----KQKYNIDSNGGAIWSIAINP-ENTILAIG---CDDGVLYDFSI--GPDKITYKRSLMRQKSRVLSLSWNPTG 166 (691)
T ss_pred ccC-----ceeEEecCCCcceeEEEeCC-ccceEEee---cCCceEEEEec--CCceEEEEeecccccceEEEEEecCCc
Confidence 986 57788888999999999999 77888874 69996555554 444442 4567677889999999998
Q ss_pred hhhhccc
Q 000080 2379 NFALSKC 2385 (2389)
Q Consensus 2379 ~~~~s~~ 2385 (2389)
-.+..-|
T Consensus 167 ~~i~~Gs 173 (691)
T KOG2048|consen 167 TKIAGGS 173 (691)
T ss_pred cEEEecc
Confidence 8666554
No 208
>KOG2110 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=98.30 E-value=1.1e-05 Score=97.50 Aligned_cols=140 Identities=15% Similarity=0.133 Sum_probs=107.6
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe--CCCcEEEe
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA--LDGTVCTW 2298 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS--~DgTVkLW 2298 (2389)
+|-+|.++. +.|+..=.+. |+|+|+.+=+.+.|+...|. |-..+.++.+++.+.++|-=+ .-|.|.||
T Consensus 89 ~IL~VrmNr--~RLvV~Lee~-IyIydI~~MklLhTI~t~~~-------n~~gl~AlS~n~~n~ylAyp~s~t~GdV~l~ 158 (391)
T KOG2110|consen 89 SILAVRMNR--KRLVVCLEES-IYIYDIKDMKLLHTIETTPP-------NPKGLCALSPNNANCYLAYPGSTTSGDVVLF 158 (391)
T ss_pred ceEEEEEcc--ceEEEEEccc-EEEEecccceeehhhhccCC-------CccceEeeccCCCCceEEecCCCCCceEEEE
Confidence 346666665 4466655554 99999998888888753222 235688888888888888633 35899999
Q ss_pred eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCe-EEEeeCCCCCCCceEEEEee--cCcEEEEeec
Q 000080 2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGIN-VVVWDTLAPPTSSRASITCH--EGLYDLFLPL 2375 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~T-VrLWD~l~~tg~~v~sL~GH--~~~V~svA~~ 2375 (2389)
|+.+- +++.++.+|.+.+.++||+| ||.+|||| |+.|| ||+..+ +.|+.++.|.-- .-.|.+++|+
T Consensus 159 d~~nl-----~~v~~I~aH~~~lAalafs~-~G~llATA---SeKGTVIRVf~v--~~G~kl~eFRRG~~~~~IySL~Fs 227 (391)
T KOG2110|consen 159 DTINL-----QPVNTINAHKGPLAALAFSP-DGTLLATA---SEKGTVIRVFSV--PEGQKLYEFRRGTYPVSIYSLSFS 227 (391)
T ss_pred Ecccc-----eeeeEEEecCCceeEEEECC-CCCEEEEe---ccCceEEEEEEc--CCccEeeeeeCCceeeEEEEEEEC
Confidence 99863 78899999999999999999 99999998 45555 899998 778888777433 3456699999
Q ss_pred ccchhh
Q 000080 2376 KLLNFA 2381 (2389)
Q Consensus 2376 ~~~~~~ 2381 (2389)
|++.|.
T Consensus 228 ~ds~~L 233 (391)
T KOG2110|consen 228 PDSQFL 233 (391)
T ss_pred CCCCeE
Confidence 999864
No 209
>PRK03629 tolB translocation protein TolB; Provisional
Probab=98.30 E-value=6.3e-06 Score=103.25 Aligned_cols=140 Identities=9% Similarity=0.040 Sum_probs=92.3
Q ss_pred EEEEEcCCCCeEEEE-eCCC--cEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC-CcEEEe
Q 000080 2223 RAFSSHPLRPFFLVG-SSNT--HIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD-GTVCTW 2298 (2389)
Q Consensus 2223 rsVAFsPdG~~LASG-S~Dg--TIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D-gTVkLW 2298 (2389)
.+++|+|||+.|+.. +.++ .|++||+.+|+..+... +...+...+|||||+.|+.++.+ +..+||
T Consensus 246 ~~~~~SPDG~~La~~~~~~g~~~I~~~d~~tg~~~~lt~-----------~~~~~~~~~wSPDG~~I~f~s~~~g~~~Iy 314 (429)
T PRK03629 246 GAPAFSPDGSKLAFALSKTGSLNLYVMDLASGQIRQVTD-----------GRSNNTEPTWFPDSQNLAYTSDQAGRPQVY 314 (429)
T ss_pred CCeEECCCCCEEEEEEcCCCCcEEEEEECCCCCEEEccC-----------CCCCcCceEECCCCCEEEEEeCCCCCceEE
Confidence 346899999988754 4444 59999998887543221 12457889999999999888865 556666
Q ss_pred --eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080 2299 --QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus 2299 --Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
|+.++. ...+..+.......+|+| ||+.||.++....+..|.+||+ .+++ .+.|.. .......+++|
T Consensus 315 ~~d~~~g~------~~~lt~~~~~~~~~~~Sp-DG~~Ia~~~~~~g~~~I~~~dl--~~g~-~~~Lt~-~~~~~~p~~Sp 383 (429)
T PRK03629 315 KVNINGGA------PQRITWEGSQNQDADVSS-DGKFMVMVSSNGGQQHIAKQDL--ATGG-VQVLTD-TFLDETPSIAP 383 (429)
T ss_pred EEECCCCC------eEEeecCCCCccCEEECC-CCCEEEEEEccCCCceEEEEEC--CCCC-eEEeCC-CCCCCCceECC
Confidence 555441 223333444566789999 9999988652223356888997 3333 455542 22234677889
Q ss_pred cchhhhcc
Q 000080 2377 LLNFALSK 2384 (2389)
Q Consensus 2377 ~~~~~~s~ 2384 (2389)
+|++++.-
T Consensus 384 DG~~i~~~ 391 (429)
T PRK03629 384 NGTMVIYS 391 (429)
T ss_pred CCCEEEEE
Confidence 99987653
No 210
>KOG0771 consensus Prolactin regulatory element-binding protein/Protein transport protein SEC12p [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.29 E-value=1.9e-06 Score=104.90 Aligned_cols=151 Identities=16% Similarity=0.158 Sum_probs=105.5
Q ss_pred ccccccceeeccccccccccccc------cCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEec----
Q 000080 2189 PGYAGIGASALGWETQDDFEDYV------DPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYG---- 2258 (2389)
Q Consensus 2189 ~g~~~~~Asg~~~d~~~~~~~~~------d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~---- 2258 (2389)
.|.+..+|.| |-|..-|+|++- +..++- -.|..++|+|||++|||-+.| ..++|++.+|-+++...
T Consensus 153 ~~~gs~latg-g~dg~lRv~~~Ps~~t~l~e~~~~--~eV~DL~FS~dgk~lasig~d-~~~VW~~~~g~~~a~~t~~~k 228 (398)
T KOG0771|consen 153 NGDGSKLATG-GTDGTLRVWEWPSMLTILEEIAHH--AEVKDLDFSPDGKFLASIGAD-SARVWSVNTGAALARKTPFSK 228 (398)
T ss_pred cCCCCEeeec-cccceEEEEecCcchhhhhhHhhc--CccccceeCCCCcEEEEecCC-ceEEEEeccCchhhhcCCccc
Confidence 3444556666 667777777652 111221 256899999999999999999 89999999994332221
Q ss_pred ----------------------c-cCCCCCC------CCC-----------CCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080 2259 ----------------------V-LPAANVP------PPY-----------ALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus 2259 ----------------------v-l~gh~~p------~~G-----------H~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
. .|+..+. .-+ -...|++++.|+||+++|-|+.||.|-+.
T Consensus 229 ~~~~~~cRF~~d~~~~~l~laa~~~~~~~v~~~~~~~w~~~~~l~~~~~~~~~~siSsl~VS~dGkf~AlGT~dGsVai~ 308 (398)
T KOG0771|consen 229 DEMFSSCRFSVDNAQETLRLAASQFPGGGVRLCDISLWSGSNFLRLRKKIKRFKSISSLAVSDDGKFLALGTMDGSVAIY 308 (398)
T ss_pred chhhhhceecccCCCceEEEEEecCCCCceeEEEeeeeccccccchhhhhhccCcceeEEEcCCCcEEEEeccCCcEEEE
Confidence 0 0111000 000 01469999999999999999999999999
Q ss_pred eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
++.+-. .....-+.|...|.+|+|+| |.+.+++. |.|.++.|--+
T Consensus 309 ~~~~lq----~~~~vk~aH~~~VT~ltF~P-dsr~~~sv---Ss~~~~~v~~l 353 (398)
T KOG0771|consen 309 DAKSLQ----RLQYVKEAHLGFVTGLTFSP-DSRYLASV---SSDNEAAVTKL 353 (398)
T ss_pred Eeceee----eeEeehhhheeeeeeEEEcC-CcCccccc---ccCCceeEEEE
Confidence 998642 22333467999999999999 88999985 57777777665
No 211
>KOG0322 consensus G-protein beta subunit-like protein GNB1L, contains WD repeats [General function prediction only]
Probab=98.28 E-value=1.4e-06 Score=101.37 Aligned_cols=113 Identities=13% Similarity=0.207 Sum_probs=92.1
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCC--ce-eeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEE
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKD--KA-TATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCT 2297 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tG--k~-l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkL 2297 (2389)
+|.++.|.+.-..=++|+.|-.+-.|.+... .+ ++....+ .| ..|..|.+-|||+.||||++|+.||+
T Consensus 207 pvlsldyas~~~rGisgga~dkl~~~Sl~~s~gslq~~~e~~l--------kn-pGv~gvrIRpD~KIlATAGWD~RiRV 277 (323)
T KOG0322|consen 207 PVLSLDYASSCDRGISGGADDKLVMYSLNHSTGSLQIRKEITL--------KN-PGVSGVRIRPDGKILATAGWDHRIRV 277 (323)
T ss_pred cceeeeechhhcCCcCCCccccceeeeeccccCcccccceEEe--------cC-CCccceEEccCCcEEeecccCCcEEE
Confidence 6788899987777789999999999997643 32 1111100 11 44899999999999999999999999
Q ss_pred eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
+.-++. +|+.-+.-|++.|++|||+| |..++|+| |.|.+|-||++
T Consensus 278 yswrtl-----~pLAVLkyHsagvn~vAfsp-d~~lmAaa---skD~rISLWkL 322 (323)
T KOG0322|consen 278 YSWRTL-----NPLAVLKYHSAGVNAVAFSP-DCELMAAA---SKDARISLWKL 322 (323)
T ss_pred EEeccC-----CchhhhhhhhcceeEEEeCC-CCchhhhc---cCCceEEeeec
Confidence 999986 57888888999999999999 77999987 69999999985
No 212
>PRK05137 tolB translocation protein TolB; Provisional
Probab=98.26 E-value=7.2e-06 Score=102.52 Aligned_cols=138 Identities=12% Similarity=0.001 Sum_probs=92.1
Q ss_pred EEEEEcCCCCeEE-EEeCCCc--EEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-CC--cEE
Q 000080 2223 RAFSSHPLRPFFL-VGSSNTH--IYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-DG--TVC 2296 (2389)
Q Consensus 2223 rsVAFsPdG~~LA-SGS~DgT--IRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-Dg--TVk 2296 (2389)
.+.+|+|||+.|+ +.+.|+. |++||+.+++..+ +. . +...++..+|||||++||.++. +| .|.
T Consensus 249 ~~~~~SPDG~~la~~~~~~g~~~Iy~~d~~~~~~~~-Lt---~-------~~~~~~~~~~spDG~~i~f~s~~~g~~~Iy 317 (435)
T PRK05137 249 FAPRFSPDGRKVVMSLSQGGNTDIYTMDLRSGTTTR-LT---D-------SPAIDTSPSYSPDGSQIVFESDRSGSPQLY 317 (435)
T ss_pred cCcEECCCCCEEEEEEecCCCceEEEEECCCCceEE-cc---C-------CCCccCceeEcCCCCEEEEEECCCCCCeEE
Confidence 4568999999765 5566655 7788988776533 32 1 2244677899999999998874 33 577
Q ss_pred EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080 2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus 2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
+||+.++. ...+..+...+...+|+| ||+.||.......+..|.+||+ .++..+.+. +...+...+++|
T Consensus 318 ~~d~~g~~------~~~lt~~~~~~~~~~~Sp-dG~~ia~~~~~~~~~~i~~~d~---~~~~~~~lt-~~~~~~~p~~sp 386 (435)
T PRK05137 318 VMNADGSN------PRRISFGGGRYSTPVWSP-RGDLIAFTKQGGGQFSIGVMKP---DGSGERILT-SGFLVEGPTWAP 386 (435)
T ss_pred EEECCCCC------eEEeecCCCcccCeEECC-CCCEEEEEEcCCCceEEEEEEC---CCCceEecc-CCCCCCCCeECC
Confidence 77887542 233333445566788999 9999987643223357888886 233444443 233567888999
Q ss_pred cchhhh
Q 000080 2377 LLNFAL 2382 (2389)
Q Consensus 2377 ~~~~~~ 2382 (2389)
+|++++
T Consensus 387 DG~~i~ 392 (435)
T PRK05137 387 NGRVIM 392 (435)
T ss_pred CCCEEE
Confidence 999865
No 213
>PRK00178 tolB translocation protein TolB; Provisional
Probab=98.25 E-value=1.4e-05 Score=99.30 Aligned_cols=139 Identities=9% Similarity=0.001 Sum_probs=90.5
Q ss_pred eEEEEEEcCCCCeEEEEeCC---CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEE-EEeCCC--c
Q 000080 2221 STRAFSSHPLRPFFLVGSSN---THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFA-SAALDG--T 2294 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~D---gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LA-SgS~Dg--T 2294 (2389)
.+.+.+|+|||+.||..+.+ ..|.+||+.+|+..+... .+ +.+.+.+|||||++|| +.+.+| .
T Consensus 200 ~~~~p~wSpDG~~la~~s~~~~~~~l~~~~l~~g~~~~l~~-~~----------g~~~~~~~SpDG~~la~~~~~~g~~~ 268 (430)
T PRK00178 200 PILSPRWSPDGKRIAYVSFEQKRPRIFVQNLDTGRREQITN-FE----------GLNGAPAWSPDGSKLAFVLSKDGNPE 268 (430)
T ss_pred ceeeeeECCCCCEEEEEEcCCCCCEEEEEECCCCCEEEccC-CC----------CCcCCeEECCCCCEEEEEEccCCCce
Confidence 34778999999999887754 469999998887543211 11 2345789999999988 455555 5
Q ss_pred EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCC--eEEEeeCCCCCCCceEEEEeecCcEEEE
Q 000080 2295 VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGI--NVVVWDTLAPPTSSRASITCHEGLYDLF 2372 (2389)
Q Consensus 2295 VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~--TVrLWD~l~~tg~~v~sL~GH~~~V~sv 2372 (2389)
|.+||++++. ...+..+.....+.+|+| ||+.|+..+ ..++ .|.++|+ .+++ +..+..........
T Consensus 269 Iy~~d~~~~~------~~~lt~~~~~~~~~~~sp-Dg~~i~f~s--~~~g~~~iy~~d~--~~g~-~~~lt~~~~~~~~~ 336 (430)
T PRK00178 269 IYVMDLASRQ------LSRVTNHPAIDTEPFWGK-DGRTLYFTS--DRGGKPQIYKVNV--NGGR-AERVTFVGNYNARP 336 (430)
T ss_pred EEEEECCCCC------eEEcccCCCCcCCeEECC-CCCEEEEEE--CCCCCceEEEEEC--CCCC-EEEeecCCCCccce
Confidence 7777998752 233445555666789999 899887653 2333 4666665 3444 33333222223456
Q ss_pred eecccchhhh
Q 000080 2373 LPLKLLNFAL 2382 (2389)
Q Consensus 2373 A~~~~~~~~~ 2382 (2389)
+.+|+|++++
T Consensus 337 ~~Spdg~~i~ 346 (430)
T PRK00178 337 RLSADGKTLV 346 (430)
T ss_pred EECCCCCEEE
Confidence 7788888764
No 214
>PRK04922 tolB translocation protein TolB; Provisional
Probab=98.23 E-value=8.3e-06 Score=102.00 Aligned_cols=139 Identities=17% Similarity=0.071 Sum_probs=89.6
Q ss_pred EEEEEcCCCCeEE-EEeCCC--cEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-CCc--EE
Q 000080 2223 RAFSSHPLRPFFL-VGSSNT--HIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-DGT--VC 2296 (2389)
Q Consensus 2223 rsVAFsPdG~~LA-SGS~Dg--TIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-DgT--Vk 2296 (2389)
.+.+|+|||+.|+ +.+.++ .|++||+.+|+..+ +. . |......++|+|||++|+.++. +|. |.
T Consensus 251 ~~~~~SpDG~~l~~~~s~~g~~~Iy~~d~~~g~~~~-lt---~-------~~~~~~~~~~spDG~~l~f~sd~~g~~~iy 319 (433)
T PRK04922 251 GAPSFSPDGRRLALTLSRDGNPEIYVMDLGSRQLTR-LT---N-------HFGIDTEPTWAPDGKSIYFTSDRGGRPQIY 319 (433)
T ss_pred cCceECCCCCEEEEEEeCCCCceEEEEECCCCCeEE-Cc---c-------CCCCccceEECCCCCEEEEEECCCCCceEE
Confidence 3568999999765 555555 69999998887543 22 1 2234567899999999998874 455 55
Q ss_pred EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080 2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus 2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
++|+.++. ...+.-+......++|+| ||+.||.......+..|.+||+ .+++ .+.|. +.......+.+|
T Consensus 320 ~~dl~~g~------~~~lt~~g~~~~~~~~Sp-DG~~Ia~~~~~~~~~~I~v~d~--~~g~-~~~Lt-~~~~~~~p~~sp 388 (433)
T PRK04922 320 RVAASGGS------AERLTFQGNYNARASVSP-DGKKIAMVHGSGGQYRIAVMDL--STGS-VRTLT-PGSLDESPSFAP 388 (433)
T ss_pred EEECCCCC------eEEeecCCCCccCEEECC-CCCEEEEEECCCCceeEEEEEC--CCCC-eEECC-CCCCCCCceECC
Confidence 55666542 122222333445689999 9999987532122346999997 3333 34454 333455778999
Q ss_pred cchhhhc
Q 000080 2377 LLNFALS 2383 (2389)
Q Consensus 2377 ~~~~~~s 2383 (2389)
+|++++-
T Consensus 389 dG~~i~~ 395 (433)
T PRK04922 389 NGSMVLY 395 (433)
T ss_pred CCCEEEE
Confidence 9998753
No 215
>PRK04792 tolB translocation protein TolB; Provisional
Probab=98.21 E-value=1.5e-05 Score=100.63 Aligned_cols=140 Identities=10% Similarity=0.018 Sum_probs=88.9
Q ss_pred EEEEEEcCCCCeEEEEeCC---CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEE-EeCCCc--E
Q 000080 2222 TRAFSSHPLRPFFLVGSSN---THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFAS-AALDGT--V 2295 (2389)
Q Consensus 2222 VrsVAFsPdG~~LASGS~D---gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LAS-gS~DgT--V 2295 (2389)
+.+.+|+|||+.|+..+.+ ..|++||+.+|+... +...+ ....+.+|||||+.||. .+.||. |
T Consensus 220 ~~~p~wSPDG~~La~~s~~~g~~~L~~~dl~tg~~~~-lt~~~----------g~~~~~~wSPDG~~La~~~~~~g~~~I 288 (448)
T PRK04792 220 LMSPAWSPDGRKLAYVSFENRKAEIFVQDIYTQVREK-VTSFP----------GINGAPRFSPDGKKLALVLSKDGQPEI 288 (448)
T ss_pred ccCceECCCCCEEEEEEecCCCcEEEEEECCCCCeEE-ecCCC----------CCcCCeeECCCCCEEEEEEeCCCCeEE
Confidence 4667999999998877643 258999998887532 21111 12346899999998875 566675 6
Q ss_pred EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeec
Q 000080 2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPL 2375 (2389)
Q Consensus 2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~ 2375 (2389)
.+||++++. ...+..+.......+|+| ||+.|+.++ ..++..+||.+...+++ ...+..+.......+.+
T Consensus 289 y~~dl~tg~------~~~lt~~~~~~~~p~wSp-DG~~I~f~s--~~~g~~~Iy~~dl~~g~-~~~Lt~~g~~~~~~~~S 358 (448)
T PRK04792 289 YVVDIATKA------LTRITRHRAIDTEPSWHP-DGKSLIFTS--ERGGKPQIYRVNLASGK-VSRLTFEGEQNLGGSIT 358 (448)
T ss_pred EEEECCCCC------eEECccCCCCccceEECC-CCCEEEEEE--CCCCCceEEEEECCCCC-EEEEecCCCCCcCeeEC
Confidence 677887652 234444555667899999 999888753 23444445443223343 44443222223456889
Q ss_pred ccchhhh
Q 000080 2376 KLLNFAL 2382 (2389)
Q Consensus 2376 ~~~~~~~ 2382 (2389)
|+|++++
T Consensus 359 pDG~~l~ 365 (448)
T PRK04792 359 PDGRSMI 365 (448)
T ss_pred CCCCEEE
Confidence 9998753
No 216
>KOG1524 consensus WD40 repeat-containing protein CHE-2 [General function prediction only]
Probab=98.19 E-value=4.4e-06 Score=103.45 Aligned_cols=139 Identities=12% Similarity=0.120 Sum_probs=108.8
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.|.+-.|+|||.=|+|+++||.||+|. ++|-+..|+.+ ....|+|+++.|+.+.+.-+-.| .+.+=-+
T Consensus 106 A~~~gRW~~dGtgLlt~GEDG~iKiWS-rsGMLRStl~Q----------~~~~v~c~~W~p~S~~vl~c~g~-h~~IKpL 173 (737)
T KOG1524|consen 106 AISSGRWSPDGAGLLTAGEDGVIKIWS-RSGMLRSTVVQ----------NEESIRCARWAPNSNSIVFCQGG-HISIKPL 173 (737)
T ss_pred hhhhcccCCCCceeeeecCCceEEEEe-ccchHHHHHhh----------cCceeEEEEECCCCCceEEecCC-eEEEeec
Confidence 345668999999999999999999999 57866655531 12569999999998766655443 3444333
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
... .....+.+|.+-|.++.|+| ...+||||| +|-.-||||- .|..+..=+.|+-+|++||+-|+-.|
T Consensus 174 ~~n-----~k~i~WkAHDGiiL~~~W~~-~s~lI~sgG---ED~kfKvWD~---~G~~Lf~S~~~ey~ITSva~npd~~~ 241 (737)
T KOG1524|consen 174 AAN-----SKIIRWRAHDGLVLSLSWST-QSNIIASGG---EDFRFKIWDA---QGANLFTSAAEEYAITSVAFNPEKDY 241 (737)
T ss_pred ccc-----cceeEEeccCcEEEEeecCc-cccceeecC---CceeEEeecc---cCcccccCChhccceeeeeeccccce
Confidence 321 23456789999999999999 789999985 9999999995 57777777789999999999999988
Q ss_pred hhc
Q 000080 2381 ALS 2383 (2389)
Q Consensus 2381 ~~s 2383 (2389)
||-
T Consensus 242 ~v~ 244 (737)
T KOG1524|consen 242 LLW 244 (737)
T ss_pred eee
Confidence 873
No 217
>KOG3914 consensus WD repeat protein WDR4 [Function unknown]
Probab=98.19 E-value=3.6e-06 Score=102.25 Aligned_cols=119 Identities=8% Similarity=0.050 Sum_probs=91.2
Q ss_pred EEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCC
Q 000080 2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus 2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~ 2301 (2389)
++.+...........++++..+.+|....|.+... .||...|+.|++|||++++.+++.|..||+=..-
T Consensus 113 i~~~~~~~sv~v~dkagD~~~~di~s~~~~~~~~~-----------lGhvSml~dVavS~D~~~IitaDRDEkIRvs~yp 181 (390)
T KOG3914|consen 113 ISFIREDTSVLVADKAGDVYSFDILSADSGRCEPI-----------LGHVSMLLDVAVSPDDQFIITADRDEKIRVSRYP 181 (390)
T ss_pred eeeeeccceEEEEeecCCceeeeeecccccCcchh-----------hhhhhhhheeeecCCCCEEEEecCCceEEEEecC
Confidence 35566666666666778888888888866665444 4789999999999999999999999999975433
Q ss_pred CCCccCccccee-eeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080 2302 VGGRSNVRPMES-CLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus 2302 tggrs~~k~l~t-l~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
.. ..+.+ +.||...|..++.-+ ++.|+|| |.|+|||+||+ .++++++++.
T Consensus 182 a~-----f~IesfclGH~eFVS~isl~~--~~~LlS~---sGD~tlr~Wd~--~sgk~L~t~d 232 (390)
T KOG3914|consen 182 AT-----FVIESFCLGHKEFVSTISLTD--NYLLLSG---SGDKTLRLWDI--TSGKLLDTCD 232 (390)
T ss_pred cc-----cchhhhccccHhheeeeeecc--Cceeeec---CCCCcEEEEec--ccCCcccccc
Confidence 21 22333 468999999999997 5778886 48999999998 5777776654
No 218
>KOG2139 consensus WD40 repeat protein [General function prediction only]
Probab=98.18 E-value=3.4e-05 Score=92.99 Aligned_cols=151 Identities=21% Similarity=0.349 Sum_probs=99.4
Q ss_pred CCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccc---cccccceeeeeccCCCCCeeEEEEcCCCCCCCcEE-
Q 000080 38 TRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEA---LIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLA- 113 (2389)
Q Consensus 38 ~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~---~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIa- 113 (2389)
-|.+..++|-|- +..-+|.|--..+-|-..+. ..+-.+ .-+.-=-|++.+.+| .+|++.+|.|| ++.++
T Consensus 140 QrnvtclawRPl--saselavgCr~gIciW~~s~-tln~~r~~~~~s~~~~qvl~~pgh-~pVtsmqwn~d---gt~l~t 212 (445)
T KOG2139|consen 140 QRNVTCLAWRPL--SASELAVGCRAGICIWSDSR-TLNANRNIRMMSTHHLQVLQDPGH-NPVTSMQWNED---GTILVT 212 (445)
T ss_pred hcceeEEEeccC--CcceeeeeecceeEEEEcCc-ccccccccccccccchhheeCCCC-ceeeEEEEcCC---CCEEee
Confidence 366778999986 33455555555555544322 222111 001111277777666 59999999998 66666
Q ss_pred Eec-CCeEEEEeeCCCCCCCCccceeeEEec--ccceEEEEeecCCCCeEEEEecc--eEEeeccCCcEEEEEEeecccc
Q 000080 114 AAS-ENCIFVFAHDSASSKGSFCWSQNAILV--QGTKVEAIEWTGSGDGIVAGGME--TVLWKKKNTLWEIAWKFKENYP 188 (2389)
Q Consensus 114 ASy-DntIRVw~~d~~~~kgd~~W~~~~tL~--hssTV~sIAWSpdG~rLaSggdD--V~IW~~~~s~Wecvwt~~~~~~ 188 (2389)
||+ |..|+||.++.+ ....|. .-+-+.-+.|||||+.|.++..| -++|+....-|..=|-+. +
T Consensus 213 AS~gsssi~iWdpdtg---------~~~pL~~~glgg~slLkwSPdgd~lfaAt~davfrlw~e~q~wt~erw~lg---s 280 (445)
T KOG2139|consen 213 ASFGSSSIMIWDPDTG---------QKIPLIPKGLGGFSLLKWSPDGDVLFAATCDAVFRLWQENQSWTKERWILG---S 280 (445)
T ss_pred cccCcceEEEEcCCCC---------CcccccccCCCceeeEEEcCCCCEEEEecccceeeeehhcccceecceecc---C
Confidence 565 589999999821 111222 34567789999999999988887 789988777777777543 2
Q ss_pred ceEEEEeecCCCc--eEeeec
Q 000080 189 QNLVSATWSIEGP--SATAAS 207 (2389)
Q Consensus 189 ~~ivsvaWSpdG~--fATag~ 207 (2389)
..+-..-|+|+|. +-+|++
T Consensus 281 grvqtacWspcGsfLLf~~sg 301 (445)
T KOG2139|consen 281 GRVQTACWSPCGSFLLFACSG 301 (445)
T ss_pred CceeeeeecCCCCEEEEEEcC
Confidence 3455778999998 666666
No 219
>PRK01029 tolB translocation protein TolB; Provisional
Probab=98.16 E-value=0.00011 Score=92.70 Aligned_cols=200 Identities=14% Similarity=0.160 Sum_probs=104.0
Q ss_pred cceeecCCCCCCeE--EEEecCCc-EEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEEec--
Q 000080 42 STIDWLPDFAGYSW--VAYGASSL-LVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAAAS-- 116 (2389)
Q Consensus 42 ~ai~wlpD~~G~~~--vAYasg~~-vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaASy-- 116 (2389)
..+.|+||.+++.+ ++|..|.. |.+..+.. + +.. ++-...+ .....+|||| +..||...
T Consensus 188 ~sP~wSPDG~~~~~~y~S~~~g~~~I~~~~l~~---g-~~~------~lt~~~g---~~~~p~wSPD---G~~Laf~s~~ 251 (428)
T PRK01029 188 ITPTWMHIGSGFPYLYVSYKLGVPKIFLGSLEN---P-AGK------KILALQG---NQLMPTFSPR---KKLLAFISDR 251 (428)
T ss_pred ccceEccCCCceEEEEEEccCCCceEEEEECCC---C-Cce------EeecCCC---CccceEECCC---CCEEEEEECC
Confidence 46799999655423 45555543 44445432 3 211 2322222 2556899999 66777433
Q ss_pred CCeEEE----EeeCCCCCCCCccceeeEEec-c-cceEEEEeecCCCCeEEEEecc---eEEeecc----CCcEEEEEEe
Q 000080 117 ENCIFV----FAHDSASSKGSFCWSQNAILV-Q-GTKVEAIEWTGSGDGIVAGGME---TVLWKKK----NTLWEIAWKF 183 (2389)
Q Consensus 117 DntIRV----w~~d~~~~kgd~~W~~~~tL~-h-ssTV~sIAWSpdG~rLaSggdD---V~IW~~~----~s~Wecvwt~ 183 (2389)
++.-.+ |..+.. ..+. ...++ . ...+...+|+|||++|+..++. .+||... .+.-+.+
T Consensus 252 ~g~~di~~~~~~~~~g-~~g~-----~~~lt~~~~~~~~~p~wSPDG~~Laf~s~~~g~~~ly~~~~~~~g~~~~~l--- 322 (428)
T PRK01029 252 YGNPDLFIQSFSLETG-AIGK-----PRRLLNEAFGTQGNPSFSPDGTRLVFVSNKDGRPRIYIMQIDPEGQSPRLL--- 322 (428)
T ss_pred CCCcceeEEEeecccC-CCCc-----ceEeecCCCCCcCCeEECCCCCEEEEEECCCCCceEEEEECcccccceEEe---
Confidence 222223 332210 0011 11222 2 2345678999999999977752 5677532 1111222
Q ss_pred eccccceEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCC
Q 000080 184 KENYPQNLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDT 262 (2389)
Q Consensus 184 ~~~~~~~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dg 262 (2389)
. .+...+...+|||||. +|.++.... ..-++++..++.. . .........+....|+| ||
T Consensus 323 t-~~~~~~~~p~wSPDG~~Laf~~~~~g---------~~~I~v~dl~~g~-~-~~Lt~~~~~~~~p~wSp--------DG 382 (428)
T PRK01029 323 T-KKYRNSSCPAWSPDGKKIAFCSVIKG---------VRQICVYDLATGR-D-YQLTTSPENKESPSWAI--------DS 382 (428)
T ss_pred c-cCCCCccceeECCCCCEEEEEEcCCC---------CcEEEEEECCCCC-e-EEccCCCCCccceEECC--------CC
Confidence 1 1223445679999999 887765311 1235555333222 1 12222345678899999 66
Q ss_pred ccccCceEEeeecCCeEEEEEee-cCCcc
Q 000080 263 KRSQRHVLLTCCLDGTVRLWCEM-DSGKT 290 (2389)
Q Consensus 263 k~~~~nILAScSdDgTVRLW~e~-d~Gk~ 290 (2389)
+. |+.++..++.-.||... +.|+.
T Consensus 383 ~~----L~f~~~~~g~~~L~~vdl~~g~~ 407 (428)
T PRK01029 383 LH----LVYSAGNSNESELYLISLITKKT 407 (428)
T ss_pred CE----EEEEECCCCCceEEEEECCCCCE
Confidence 66 44566666655666544 33444
No 220
>KOG2139 consensus WD40 repeat protein [General function prediction only]
Probab=98.16 E-value=2.9e-05 Score=93.50 Aligned_cols=186 Identities=16% Similarity=0.232 Sum_probs=109.4
Q ss_pred EEEecCCcEEEEeCCCCcccccccccccceeeeec-cCCCCCeeEEEEcCCCCCCCcEEEecCCeEEEEeeCCCCCCCCc
Q 000080 56 VAYGASSLLVISHFPSPLSQEEALIGPIFRQVFAL-SDNSLPVTSISWSPETPSIGQLAAASENCIFVFAHDSASSKGSF 134 (2389)
Q Consensus 56 vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qvieg-h~d~~dVk~VaWSPd~~~~GeIaASyDntIRVw~~d~~~~kgd~ 134 (2389)
.|.|..+++|... +-.+. +. .++.. ++ .+|+|++|-|- +..+++.++-..|++|..+...+.+..
T Consensus 113 fava~nddvVriy--~ksst--~p------t~Lks~sQ--rnvtclawRPl--saselavgCr~gIciW~~s~tln~~r~ 178 (445)
T KOG2139|consen 113 FAVATNDDVVRIY--DKSST--CP------TKLKSVSQ--RNVTCLAWRPL--SASELAVGCRAGICIWSDSRTLNANRN 178 (445)
T ss_pred hhhhccCcEEEEe--ccCCC--CC------ceecchhh--cceeEEEeccC--CcceeeeeecceeEEEEcCcccccccc
Confidence 4666667777666 21111 12 23332 22 37999999996 556788888889999988742111110
Q ss_pred ----cceeeEEec--ccceEEEEeecCCCCeEEEEecc---eEEeeccCCcEEEEEEeeccccceEEEEeecCCCc--eE
Q 000080 135 ----CWSQNAILV--QGTKVEAIEWTGSGDGIVAGGME---TVLWKKKNTLWEIAWKFKENYPQNLVSATWSIEGP--SA 203 (2389)
Q Consensus 135 ----~W~~~~tL~--hssTV~sIAWSpdG~rLaSggdD---V~IW~~~~s~Wecvwt~~~~~~~~ivsvaWSpdG~--fA 203 (2389)
.=.+.+.+. ..-.|.+++|++||.+|++++.+ +.||+-..+...-+ ...+...+--..|||||. ||
T Consensus 179 ~~~~s~~~~qvl~~pgh~pVtsmqwn~dgt~l~tAS~gsssi~iWdpdtg~~~pL---~~~glgg~slLkwSPdgd~lfa 255 (445)
T KOG2139|consen 179 IRMMSTHHLQVLQDPGHNPVTSMQWNEDGTILVTASFGSSSIMIWDPDTGQKIPL---IPKGLGGFSLLKWSPDGDVLFA 255 (445)
T ss_pred cccccccchhheeCCCCceeeEEEEcCCCCEEeecccCcceEEEEcCCCCCcccc---cccCCCceeeEEEcCCCCEEEE
Confidence 112333443 35689999999999999999997 99999665554322 112223332348999998 55
Q ss_pred eeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEE
Q 000080 204 TAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWC 283 (2389)
Q Consensus 204 Tag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~ 283 (2389)
+... ..|..|...+ .|.. +.. -.-++.|..-.|+| +|+. +|.+|+. .=+|+.
T Consensus 256 At~d-avfrlw~e~q----~wt~--------erw-~lgsgrvqtacWsp--------cGsf----LLf~~sg--sp~lys 307 (445)
T KOG2139|consen 256 ATCD-AVFRLWQENQ----SWTK--------ERW-ILGSGRVQTACWSP--------CGSF----LLFACSG--SPRLYS 307 (445)
T ss_pred eccc-ceeeeehhcc----ccee--------cce-eccCCceeeeeecC--------CCCE----EEEEEcC--CceEEE
Confidence 4433 2234441111 0100 000 12345788889999 5555 6777764 456666
Q ss_pred eec
Q 000080 284 EMD 286 (2389)
Q Consensus 284 e~d 286 (2389)
..=
T Consensus 308 l~f 310 (445)
T KOG2139|consen 308 LTF 310 (445)
T ss_pred Eee
Confidence 663
No 221
>KOG0321 consensus WD40 repeat-containing protein L2DTL [Function unknown]
Probab=98.14 E-value=4.2e-06 Score=105.52 Aligned_cols=115 Identities=15% Similarity=0.191 Sum_probs=89.6
Q ss_pred EEEcCC---CCeEEEEeCCCcEEEeecCCCcee---eEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080 2225 FSSHPL---RPFFLVGSSNTHIYLWEFGKDKAT---ATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus 2225 VAFsPd---G~~LASGS~DgTIRLWDl~tGk~l---~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
..|++. ..+||-+-+||.|.|+|..+-.-. +.|. -++.|.+.|..++.-|-.-+|+++++|.|+|+|
T Consensus 55 ~sFs~~~n~eHiLavadE~G~i~l~dt~~~~fr~ee~~lk-------~~~aH~nAifDl~wapge~~lVsasGDsT~r~W 127 (720)
T KOG0321|consen 55 DSFSAAPNKEHILAVADEDGGIILFDTKSIVFRLEERQLK-------KPLAHKNAIFDLKWAPGESLLVSASGDSTIRPW 127 (720)
T ss_pred ccccCCCCccceEEEecCCCceeeecchhhhcchhhhhhc-------ccccccceeEeeccCCCceeEEEccCCceeeee
Confidence 456653 347999999999999998643311 1122 134578999999999955799999999999999
Q ss_pred eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080 2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
|+++++ +.-...+.||.+.|.++||.|.|-.+++||| .|+.|.|||+.
T Consensus 128 dvk~s~---l~G~~~~~GH~~SvkS~cf~~~n~~vF~tGg---RDg~illWD~R 175 (720)
T KOG0321|consen 128 DVKTSR---LVGGRLNLGHTGSVKSECFMPTNPAVFCTGG---RDGEILLWDCR 175 (720)
T ss_pred eeccce---eecceeecccccccchhhhccCCCcceeecc---CCCcEEEEEEe
Confidence 999863 1223347899999999999997777888864 99999999984
No 222
>PRK02889 tolB translocation protein TolB; Provisional
Probab=98.14 E-value=1.4e-05 Score=99.87 Aligned_cols=141 Identities=10% Similarity=0.003 Sum_probs=88.9
Q ss_pred EEEEEcCCCCeEE-EEeCCCcEEEeec--CCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-CCcEEEe
Q 000080 2223 RAFSSHPLRPFFL-VGSSNTHIYLWEF--GKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-DGTVCTW 2298 (2389)
Q Consensus 2223 rsVAFsPdG~~LA-SGS~DgTIRLWDl--~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-DgTVkLW 2298 (2389)
.+.+|+|||+.|+ +.+.|+..+||.+ ..+. ++.+. . |...+....|||||++|+.++. +|...||
T Consensus 243 ~~~~~SPDG~~la~~~~~~g~~~Iy~~d~~~~~-~~~lt---~-------~~~~~~~~~wSpDG~~l~f~s~~~g~~~Iy 311 (427)
T PRK02889 243 SAPAWSPDGRTLAVALSRDGNSQIYTVNADGSG-LRRLT---Q-------SSGIDTEPFFSPDGRSIYFTSDRGGAPQIY 311 (427)
T ss_pred cceEECCCCCEEEEEEccCCCceEEEEECCCCC-cEECC---C-------CCCCCcCeEEcCCCCEEEEEecCCCCcEEE
Confidence 4679999999876 5678888777764 3333 33332 1 2234567889999999987765 5788888
Q ss_pred eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080 2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
.+...+. . ...+.-+.......+|+| ||+.||.++....+..|.+||+ .+++ .+.+..+ ......+++|+|
T Consensus 312 ~~~~~~g-~---~~~lt~~g~~~~~~~~Sp-DG~~Ia~~s~~~g~~~I~v~d~--~~g~-~~~lt~~-~~~~~p~~spdg 382 (427)
T PRK02889 312 RMPASGG-A---AQRVTFTGSYNTSPRISP-DGKLLAYISRVGGAFKLYVQDL--ATGQ-VTALTDT-TRDESPSFAPNG 382 (427)
T ss_pred EEECCCC-c---eEEEecCCCCcCceEECC-CCCEEEEEEccCCcEEEEEEEC--CCCC-eEEccCC-CCccCceECCCC
Confidence 7653211 1 111221223344688999 9999997642222237999997 3343 3444422 344678899999
Q ss_pred hhhhc
Q 000080 2379 NFALS 2383 (2389)
Q Consensus 2379 ~~~~s 2383 (2389)
++++-
T Consensus 383 ~~l~~ 387 (427)
T PRK02889 383 RYILY 387 (427)
T ss_pred CEEEE
Confidence 87654
No 223
>KOG1517 consensus Guanine nucleotide binding protein MIP1 [Cell cycle control, cell division, chromosome partitioning]
Probab=98.12 E-value=6.1e-05 Score=99.11 Aligned_cols=134 Identities=11% Similarity=0.147 Sum_probs=93.9
Q ss_pred EEEEEEcC-CCCeEEEEeCCCcEEEeecCCCc---eeeEecccCCCCCCCCCCCCC--EEEEEECCCCC-EEEEEeCCCc
Q 000080 2222 TRAFSSHP-LRPFFLVGSSNTHIYLWEFGKDK---ATATYGVLPAANVPPPYALAS--ISALQFDHYGH-RFASAALDGT 2294 (2389)
Q Consensus 2222 VrsVAFsP-dG~~LASGS~DgTIRLWDl~tGk---~l~Tl~vl~gh~~p~~GH~~~--V~sVaFSPDG~-~LASgS~DgT 2294 (2389)
|++++-+. .|.+||.|=.||.||+||.+-.- .+..++ . |.+. |..+.|.+.|- .|+|||.||.
T Consensus 1211 vTaLS~~~~~gn~i~AGfaDGsvRvyD~R~a~~ds~v~~~R---~-------h~~~~~Iv~~slq~~G~~elvSgs~~G~ 1280 (1387)
T KOG1517|consen 1211 VTALSADLVHGNIIAAGFADGSVRVYDRRMAPPDSLVCVYR---E-------HNDVEPIVHLSLQRQGLGELVSGSQDGD 1280 (1387)
T ss_pred ceeecccccCCceEEEeecCCceEEeecccCCccccceeec---c-------cCCcccceeEEeecCCCcceeeeccCCe
Confidence 45554333 37899999999999999987442 455565 2 4455 99999999885 5999999999
Q ss_pred EEEeeCCCCCccCcccceeeeecC--C-CeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeec-----
Q 000080 2295 VCTWQLEVGGRSNVRPMESCLCFS--S-HAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHE----- 2366 (2389)
Q Consensus 2295 VkLWDl~tggrs~~k~l~tl~gHs--~-~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~----- 2366 (2389)
|++||++...+ ..+.+...|. + ..+++..++ ...+||||+ . +.|+||++ .|+.+..+..++
T Consensus 1281 I~~~DlR~~~~---e~~~~iv~~~~yGs~lTal~VH~-hapiiAsGs---~-q~ikIy~~---~G~~l~~~k~n~~F~~q 1349 (1387)
T KOG1517|consen 1281 IQLLDLRMSSK---ETFLTIVAHWEYGSALTALTVHE-HAPIIASGS---A-QLIKIYSL---SGEQLNIIKYNPGFMGQ 1349 (1387)
T ss_pred EEEEecccCcc---cccceeeeccccCccceeeeecc-CCCeeeecC---c-ceEEEEec---ChhhhcccccCcccccC
Confidence 99999997321 2334444444 3 377888888 789999963 4 89999998 344444443332
Q ss_pred --CcEEEEeecc
Q 000080 2367 --GLYDLFLPLK 2376 (2389)
Q Consensus 2367 --~~V~svA~~~ 2376 (2389)
+.+.|+++||
T Consensus 1350 ~~gs~scL~FHP 1361 (1387)
T KOG1517|consen 1350 RIGSVSCLAFHP 1361 (1387)
T ss_pred cCCCcceeeecc
Confidence 3456777776
No 224
>PRK01029 tolB translocation protein TolB; Provisional
Probab=98.11 E-value=2.7e-05 Score=97.88 Aligned_cols=143 Identities=11% Similarity=0.042 Sum_probs=90.6
Q ss_pred EEEEcCCCCeEEEEeC-----CCcEEEeecCCC---ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe-CCCc
Q 000080 2224 AFSSHPLRPFFLVGSS-----NTHIYLWEFGKD---KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA-LDGT 2294 (2389)
Q Consensus 2224 sVAFsPdG~~LASGS~-----DgTIRLWDl~tG---k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-~DgT 2294 (2389)
..+|||||+.||-.++ |-.+.+||+.+| +..+... + +.+.+...+|||||+.||..+ .+|.
T Consensus 235 ~p~wSPDG~~Laf~s~~~g~~di~~~~~~~~~g~~g~~~~lt~---~-------~~~~~~~p~wSPDG~~Laf~s~~~g~ 304 (428)
T PRK01029 235 MPTFSPRKKLLAFISDRYGNPDLFIQSFSLETGAIGKPRRLLN---E-------AFGTQGNPSFSPDGTRLVFVSNKDGR 304 (428)
T ss_pred ceEECCCCCEEEEEECCCCCcceeEEEeecccCCCCcceEeec---C-------CCCCcCCeEECCCCCEEEEEECCCCC
Confidence 4589999998886553 334555887653 3222221 1 113346789999999999876 4777
Q ss_pred EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080 2295 VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus 2295 VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
.+||.+...+. . .....+..+...+...+||| ||+.||..+.......|.+||+ .+++ .+.+......+...+.
T Consensus 305 ~~ly~~~~~~~-g-~~~~~lt~~~~~~~~p~wSP-DG~~Laf~~~~~g~~~I~v~dl--~~g~-~~~Lt~~~~~~~~p~w 378 (428)
T PRK01029 305 PRIYIMQIDPE-G-QSPRLLTKKYRNSSCPAWSP-DGKKIAFCSVIKGVRQICVYDL--ATGR-DYQLTTSPENKESPSW 378 (428)
T ss_pred ceEEEEECccc-c-cceEEeccCCCCccceeECC-CCCEEEEEEcCCCCcEEEEEEC--CCCC-eEEccCCCCCccceEE
Confidence 77775532100 0 12333444555677899999 9999987643222357999997 3343 4555544456678889
Q ss_pred cccchhhh
Q 000080 2375 LKLLNFAL 2382 (2389)
Q Consensus 2375 ~~~~~~~~ 2382 (2389)
+|+|++++
T Consensus 379 SpDG~~L~ 386 (428)
T PRK01029 379 AIDSLHLV 386 (428)
T ss_pred CCCCCEEE
Confidence 99998865
No 225
>KOG4497 consensus Uncharacterized conserved protein WDR8, contains WD repeats [General function prediction only]
Probab=98.10 E-value=2.5e-05 Score=92.99 Aligned_cols=193 Identities=17% Similarity=0.276 Sum_probs=127.0
Q ss_pred eeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEE-ec-CCeEE
Q 000080 44 IDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAA-AS-ENCIF 121 (2389)
Q Consensus 44 i~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaA-Sy-DntIR 121 (2389)
..++|+ | .|||.++-..+||+. + ..+|.+ |.+.-- | .|.-+.|..| ...|++ .| +..|.
T Consensus 14 c~fSp~--g-~yiAs~~~yrlviRd--~--~tlq~~------qlf~cl-d--ki~yieW~ad---s~~ilC~~yk~~~vq 74 (447)
T KOG4497|consen 14 CSFSPC--G-NYIASLSRYRLVIRD--S--ETLQLH------QLFLCL-D--KIVYIEWKAD---SCHILCVAYKDPKVQ 74 (447)
T ss_pred eeECCC--C-CeeeeeeeeEEEEec--c--chhhHH------HHHHHH-H--Hhhheeeecc---ceeeeeeeeccceEE
Confidence 467888 8 699999999999998 3 122222 333222 2 6889999998 777774 45 67999
Q ss_pred EEeeCCCCCCCCccceeeEEecccceEEEEeecCCCCeEE-EEecc--eEEeeccCCcEEEEEEeeccccc-eEEEEeec
Q 000080 122 VFAHDSASSKGSFCWSQNAILVQGTKVEAIEWTGSGDGIV-AGGME--TVLWKKKNTLWEIAWKFKENYPQ-NLVSATWS 197 (2389)
Q Consensus 122 Vw~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSpdG~rLa-SggdD--V~IW~~~~s~Wecvwt~~~~~~~-~ivsvaWS 197 (2389)
+|.-. ..+|.|+..- ...-+-+++|||||+-|+ +..++ +.+|...+..--.+ .+|. ++--+++.
T Consensus 75 vwsl~------Qpew~ckIde-g~agls~~~WSPdgrhiL~tseF~lriTVWSL~t~~~~~~-----~~pK~~~kg~~f~ 142 (447)
T KOG4497|consen 75 VWSLV------QPEWYCKIDE-GQAGLSSISWSPDGRHILLTSEFDLRITVWSLNTQKGYLL-----PHPKTNVKGYAFH 142 (447)
T ss_pred EEEee------cceeEEEecc-CCCcceeeeECCCcceEeeeecceeEEEEEEeccceeEEe-----cccccCceeEEEC
Confidence 99876 3469997443 344677899999998777 66667 77999877665544 2333 23355889
Q ss_pred CCCceEee-ec-ccc--cc--------------cCC-------CCCCCceeEEEeeCCCccceeecccCC-CCeeEEEec
Q 000080 198 IEGPSATA-AS-MSQ--LD--------------LLG-------PKEAGKCVFICCSDGKSEYIKLELCHP-QPVSMVQWR 251 (2389)
Q Consensus 198 pdG~fATa-g~-dik--f~--------------~~~-------~~~~~kpV~V~~~dg~~~~~~ve~aH~-qdVn~V~W~ 251 (2389)
|||.|++- ++ |-| ++ ... =+.++....||++ -.++ +++..|- -.|+.|+|+
T Consensus 143 ~dg~f~ai~sRrDCkdyv~i~~c~~W~ll~~f~~dT~DltgieWsPdg~~laVwd~--~Ley-kv~aYe~~lG~k~v~ws 219 (447)
T KOG4497|consen 143 PDGQFCAILSRRDCKDYVQISSCKAWILLKEFKLDTIDLTGIEWSPDGNWLAVWDN--VLEY-KVYAYERGLGLKFVEWS 219 (447)
T ss_pred CCCceeeeeecccHHHHHHHHhhHHHHHHHhcCCCcccccCceECCCCcEEEEecc--hhhh-eeeeeeeccceeEEEec
Confidence 99996554 44 222 11 111 1234455667733 2222 2333444 689999999
Q ss_pred cCCCCCCCCCCccccCceEEeeecCCeEEEEE
Q 000080 252 PSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWC 283 (2389)
Q Consensus 252 Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~ 283 (2389)
|. ...||-+|+|+.+||-.
T Consensus 220 P~-------------~qflavGsyD~~lrvln 238 (447)
T KOG4497|consen 220 PC-------------NQFLAVGSYDQMLRVLN 238 (447)
T ss_pred cc-------------cceEEeeccchhhhhhc
Confidence 93 23599999999999844
No 226
>KOG1310 consensus WD40 repeat protein [General function prediction only]
Probab=98.09 E-value=6.4e-06 Score=102.25 Aligned_cols=132 Identities=20% Similarity=0.341 Sum_probs=97.3
Q ss_pred eEEec-ccceEEEEeecCCCCeEEEEecc--eEEeeccCCcEEEEEEeeccccceEEEEeecCC-Cc--eEeeecccc--
Q 000080 139 NAILV-QGTKVEAIEWTGSGDGIVAGGME--TVLWKKKNTLWEIAWKFKENYPQNLVSATWSIE-GP--SATAASMSQ-- 210 (2389)
Q Consensus 139 ~~tL~-hssTV~sIAWSpdG~rLaSggdD--V~IW~~~~s~Wecvwt~~~~~~~~ivsvaWSpd-G~--fATag~dik-- 210 (2389)
.+.|+ |++-|.+++|+.+|..||||||| +.||+-- ..+..-.+..-|..+|+++.+=|. +. ++||++|..
T Consensus 43 E~eL~GH~GCVN~LeWn~dG~lL~SGSDD~r~ivWd~~--~~KllhsI~TgHtaNIFsvKFvP~tnnriv~sgAgDk~i~ 120 (758)
T KOG1310|consen 43 EAELTGHTGCVNCLEWNADGELLASGSDDTRLIVWDPF--EYKLLHSISTGHTANIFSVKFVPYTNNRIVLSGAGDKLIK 120 (758)
T ss_pred hhhhccccceecceeecCCCCEEeecCCcceEEeecch--hcceeeeeecccccceeEEeeeccCCCeEEEeccCcceEE
Confidence 34444 89999999999999999999999 7799965 344444456678899999999995 33 899999755
Q ss_pred -cccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeecCCc
Q 000080 211 -LDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMDSGK 289 (2389)
Q Consensus 211 -f~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d~Gk 289 (2389)
|......+.. ++++-.+-...+.+|+..|+.++=.| -.+|+.-|||.|||||=+|+.|.-.
T Consensus 121 lfdl~~~~~~~------~d~~~~~~~~~~~cht~rVKria~~p------------~~PhtfwsasEDGtirQyDiREph~ 182 (758)
T KOG1310|consen 121 LFDLDSSKEGG------MDHGMEETTRCWSCHTDRVKRIATAP------------NGPHTFWSASEDGTIRQYDIREPHV 182 (758)
T ss_pred EEecccccccc------cccCccchhhhhhhhhhhhhheecCC------------CCCceEEEecCCcceeeecccCCcc
Confidence 3333111110 11222222345789999999999988 2578899999999999999998655
Q ss_pred c
Q 000080 290 T 290 (2389)
Q Consensus 290 ~ 290 (2389)
+
T Consensus 183 c 183 (758)
T KOG1310|consen 183 C 183 (758)
T ss_pred C
Confidence 5
No 227
>KOG2106 consensus Uncharacterized conserved protein, contains HELP and WD40 domains [Function unknown]
Probab=98.09 E-value=4.8e-05 Score=94.40 Aligned_cols=133 Identities=15% Similarity=0.390 Sum_probs=99.0
Q ss_pred eeccccccccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEE
Q 000080 2197 SALGWETQDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISA 2276 (2389)
Q Consensus 2197 sg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~s 2276 (2389)
|+..|..-.+.-+. .+. |-.|...+|||.++.|+..-.-+++..|+++.|...++-.-++.+ ....|.+
T Consensus 183 SVWdWqk~~~~~~v----k~s-ne~v~~a~FHPtd~nliit~Gk~H~~Fw~~~~~~l~k~~~~fek~------ekk~Vl~ 251 (626)
T KOG2106|consen 183 SVWDWQKKAKLGPV----KTS-NEVVFLATFHPTDPNLIITCGKGHLYFWTLRGGSLVKRQGIFEKR------EKKFVLC 251 (626)
T ss_pred chhhchhhhccCcc----eec-cceEEEEEeccCCCcEEEEeCCceEEEEEccCCceEEEeeccccc------cceEEEE
Confidence 44445444444432 333 223588899999987666667889999999988876653323333 1367999
Q ss_pred EEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2277 LQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2277 VaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
|+|.++|+ ..+|..+|+|.+|+..+. +..++...|.+.|.+++... +|++| ||| .|+.|-+||-
T Consensus 252 v~F~engd-viTgDS~G~i~Iw~~~~~-----~~~k~~~aH~ggv~~L~~lr-~Gtll-SGg---KDRki~~Wd~ 315 (626)
T KOG2106|consen 252 VTFLENGD-VITGDSGGNILIWSKGTN-----RISKQVHAHDGGVFSLCMLR-DGTLL-SGG---KDRKIILWDD 315 (626)
T ss_pred EEEcCCCC-EEeecCCceEEEEeCCCc-----eEEeEeeecCCceEEEEEec-CccEe-ecC---ccceEEeccc
Confidence 99999997 468999999999999753 44555559999999999998 98877 454 9999999993
No 228
>KOG1523 consensus Actin-related protein Arp2/3 complex, subunit ARPC1/p41-ARC [Cytoskeleton]
Probab=98.05 E-value=4.5e-05 Score=91.05 Aligned_cols=142 Identities=15% Similarity=0.125 Sum_probs=117.8
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc---eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEE
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK---ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCT 2297 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk---~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkL 2297 (2389)
+|.+-||++|+..+|.+-....|.|+.....+ ..+|+. -|...|+.|.++|.+++|.+++.|+.-.+
T Consensus 12 pitchAwn~drt~iAv~~~~~evhiy~~~~~~~w~~~htls----------~Hd~~vtgvdWap~snrIvtcs~drnayV 81 (361)
T KOG1523|consen 12 PITCHAWNSDRTQIAVSPNNHEVHIYSMLGADLWEPAHTLS----------EHDKIVTGVDWAPKSNRIVTCSHDRNAYV 81 (361)
T ss_pred ceeeeeecCCCceEEeccCCceEEEEEecCCCCceeceehh----------hhCcceeEEeecCCCCceeEccCCCCccc
Confidence 34888999999999999999999999986554 345553 25688999999999999999999999999
Q ss_pred eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC------------CCCCCceEEEEee
Q 000080 2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL------------APPTSSRASITCH 2365 (2389)
Q Consensus 2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l------------~~tg~~v~sL~GH 2365 (2389)
|....++ .=+|..-+.-|+..+..|.++| .++.+|++ |..+.|.||-+- .+....+.+|.-|
T Consensus 82 w~~~~~~--~WkptlvLlRiNrAAt~V~WsP-~enkFAVg---Sgar~isVcy~E~ENdWWVsKhikkPirStv~sldWh 155 (361)
T KOG1523|consen 82 WTQPSGG--TWKPTLVLLRINRAATCVKWSP-KENKFAVG---SGARLISVCYYEQENDWWVSKHIKKPIRSTVTSLDWH 155 (361)
T ss_pred cccCCCC--eeccceeEEEeccceeeEeecC-cCceEEec---cCccEEEEEEEecccceehhhhhCCccccceeeeecc
Confidence 9995554 2356677778999999999999 88999986 578999999862 2223347889999
Q ss_pred cCcEEEEeecccc
Q 000080 2366 EGLYDLFLPLKLL 2378 (2389)
Q Consensus 2366 ~~~V~svA~~~~~ 2378 (2389)
.++|..-|.+.|+
T Consensus 156 pnnVLlaaGs~D~ 168 (361)
T KOG1523|consen 156 PNNVLLAAGSTDG 168 (361)
T ss_pred CCcceecccccCc
Confidence 9999999999998
No 229
>PF00400 WD40: WD domain, G-beta repeat; InterPro: IPR019781 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events.; PDB: 2ZKQ_a 3CFV_B 3CFS_B 1PEV_A 1NR0_A 1VYH_T 3RFH_A 3O2Z_T 3FRX_C 3U5G_g ....
Probab=98.02 E-value=9.4e-06 Score=68.31 Aligned_cols=39 Identities=28% Similarity=0.475 Sum_probs=34.8
Q ss_pred CceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2251 DKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2251 Gk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
|+++.+++ ||.+.|++|+|+|++++||||+.|++|++||
T Consensus 1 g~~~~~~~----------~h~~~i~~i~~~~~~~~~~s~~~D~~i~vwd 39 (39)
T PF00400_consen 1 GKCVRTFR----------GHSSSINSIAWSPDGNFLASGSSDGTIRVWD 39 (39)
T ss_dssp EEEEEEEE----------SSSSSEEEEEEETTSSEEEEEETTSEEEEEE
T ss_pred CeEEEEEc----------CCCCcEEEEEEecccccceeeCCCCEEEEEC
Confidence 46677774 5779999999999999999999999999997
No 230
>KOG1587 consensus Cytoplasmic dynein intermediate chain [Cytoskeleton]
Probab=97.93 E-value=0.00018 Score=92.99 Aligned_cols=148 Identities=16% Similarity=0.184 Sum_probs=102.3
Q ss_pred eeEEEEEEcCCCC-eEEEEeCCCcEEE---eecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcE
Q 000080 2220 ISTRAFSSHPLRP-FFLVGSSNTHIYL---WEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTV 2295 (2389)
Q Consensus 2220 i~VrsVAFsPdG~-~LASGS~DgTIRL---WDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTV 2295 (2389)
+.+.+++|+|.-+ .++.|+++|.|.- ++...+.. ..| ++|..+ .-|.+.|++|.+||-+..+...+.|-||
T Consensus 348 ~~~t~~~F~~~~p~~FiVGTe~G~v~~~~r~g~~~~~~-~~~---~~~~~~-~~h~g~v~~v~~nPF~~k~fls~gDW~v 422 (555)
T KOG1587|consen 348 VGATSLKFEPTDPNHFIVGTEEGKVYKGCRKGYTPAPE-VSY---KGHSTF-ITHIGPVYAVSRNPFYPKNFLSVGDWTV 422 (555)
T ss_pred cceeeEeeccCCCceEEEEcCCcEEEEEeccCCccccc-ccc---cccccc-cccCcceEeeecCCCccceeeeecccee
Confidence 5778999999766 5888999999977 33322221 222 233222 2467899999999999766666669999
Q ss_pred EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeec
Q 000080 2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPL 2375 (2389)
Q Consensus 2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~ 2375 (2389)
|||.-... ..|+..+..+...|.+++|||---.++|++ ..||+|-|||++..+-..+.+..-+....+.+..+
T Consensus 423 riWs~~~~----~~Pl~~~~~~~~~v~~vaWSptrpavF~~~---d~~G~l~iWDLl~~~~~Pv~s~~~~~~~l~~~~~s 495 (555)
T KOG1587|consen 423 RIWSEDVI----ASPLLSLDSSPDYVTDVAWSPTRPAVFATV---DGDGNLDIWDLLQDDEEPVLSQKVCSPALTRVRWS 495 (555)
T ss_pred EeccccCC----CCcchhhhhccceeeeeEEcCcCceEEEEE---cCCCceehhhhhccccCCcccccccccccceeecC
Confidence 99987632 268888888999999999999333466664 58999999999755444455543334444455555
Q ss_pred ccch
Q 000080 2376 KLLN 2379 (2389)
Q Consensus 2376 ~~~~ 2379 (2389)
+.|+
T Consensus 496 ~~g~ 499 (555)
T KOG1587|consen 496 PNGK 499 (555)
T ss_pred CCCc
Confidence 4443
No 231
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=97.93 E-value=8.7e-05 Score=91.12 Aligned_cols=139 Identities=16% Similarity=0.103 Sum_probs=88.8
Q ss_pred EEEEEcCCCCeEE-EEeCC--CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC-C--cEE
Q 000080 2223 RAFSSHPLRPFFL-VGSSN--THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD-G--TVC 2296 (2389)
Q Consensus 2223 rsVAFsPdG~~LA-SGS~D--gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D-g--TVk 2296 (2389)
.+++|+|||+.|+ +.+.+ ..|++||+.+++..+ +. . +...+...+|+|||++|+.++.. + .|.
T Consensus 237 ~~~~~spDg~~l~~~~~~~~~~~i~~~d~~~~~~~~-l~---~-------~~~~~~~~~~s~dg~~l~~~s~~~g~~~iy 305 (417)
T TIGR02800 237 GAPAFSPDGSKLAVSLSKDGNPDIYVMDLDGKQLTR-LT---N-------GPGIDTEPSWSPDGKSIAFTSDRGGSPQIY 305 (417)
T ss_pred cceEECCCCCEEEEEECCCCCccEEEEECCCCCEEE-CC---C-------CCCCCCCEEECCCCCEEEEEECCCCCceEE
Confidence 4568999999765 44444 469999998776433 21 1 12335577899999999877653 3 577
Q ss_pred EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080 2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus 2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
+||+.++. ...+..+...+..++|+| ||++|+.++.......|.+||+. + ...+.+..+ ......+++|
T Consensus 306 ~~d~~~~~------~~~l~~~~~~~~~~~~sp-dg~~i~~~~~~~~~~~i~~~d~~--~-~~~~~l~~~-~~~~~p~~sp 374 (417)
T TIGR02800 306 MMDADGGE------VRRLTFRGGYNASPSWSP-DGDLIAFVHREGGGFNIAVMDLD--G-GGERVLTDT-GLDESPSFAP 374 (417)
T ss_pred EEECCCCC------EEEeecCCCCccCeEECC-CCCEEEEEEccCCceEEEEEeCC--C-CCeEEccCC-CCCCCceECC
Confidence 77877642 233444556677889999 89999886421111278888873 3 334444332 2234567888
Q ss_pred cchhhhc
Q 000080 2377 LLNFALS 2383 (2389)
Q Consensus 2377 ~~~~~~s 2383 (2389)
+|++++.
T Consensus 375 dg~~l~~ 381 (417)
T TIGR02800 375 NGRMILY 381 (417)
T ss_pred CCCEEEE
Confidence 8887654
No 232
>KOG1240 consensus Protein kinase containing WD40 repeats [Signal transduction mechanisms]
Probab=97.90 E-value=6.1e-05 Score=100.40 Aligned_cols=146 Identities=17% Similarity=0.221 Sum_probs=97.4
Q ss_pred EEEcCCCCeEEEEeCCCcEEEeecCC-----C--ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEE
Q 000080 2225 FSSHPLRPFFLVGSSNTHIYLWEFGK-----D--KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCT 2297 (2389)
Q Consensus 2225 VAFsPdG~~LASGS~DgTIRLWDl~t-----G--k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkL 2297 (2389)
...+|++.+++|||+|||||+||... + ++..||. .....|.+|.+-+.|+.+|.|+.||.|++
T Consensus 1055 a~s~~~~s~FvsgS~DGtVKvW~~~k~~~~~~s~rS~ltys----------~~~sr~~~vt~~~~~~~~Av~t~DG~v~~ 1124 (1431)
T KOG1240|consen 1055 AVSSEHTSLFVSGSDDGTVKVWNLRKLEGEGGSARSELTYS----------PEGSRVEKVTMCGNGDQFAVSTKDGSVRV 1124 (1431)
T ss_pred eecCCCCceEEEecCCceEEEeeehhhhcCcceeeeeEEEe----------ccCCceEEEEeccCCCeEEEEcCCCeEEE
Confidence 34555669999999999999999752 1 2334442 02378999999999999999999999999
Q ss_pred eeCCCC--CccCccc--ceeeeecCCCeeEEEEecCCCC-EEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEE
Q 000080 2298 WQLEVG--GRSNVRP--MESCLCFSSHAMDVSYITSSGS-VIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLF 2372 (2389)
Q Consensus 2298 WDl~tg--grs~~k~--l~tl~gHs~~V~sVAFSP~DGs-lLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~sv 2372 (2389)
-+++.. .+-.... ...+.....-|..-+|...+++ .|+-+ ..-+-|..||+...+.-..-..+-..|-|+++
T Consensus 1125 ~~id~~~~~~~~~~~~ri~n~~~~g~vv~m~a~~~~~~S~~lvy~---T~~~~iv~~D~r~~~~~w~lk~~~~hG~vTSi 1201 (1431)
T KOG1240|consen 1125 LRIDHYNVSKRVATQVRIPNLKKDGVVVSMHAFTAIVQSHVLVYA---TDLSRIVSWDTRMRHDAWRLKNQLRHGLVTSI 1201 (1431)
T ss_pred EEccccccccceeeeeecccccCCCceEEeecccccccceeEEEE---EeccceEEecchhhhhHHhhhcCccccceeEE
Confidence 999762 1000000 0111222233445566655666 55543 46778999998533222223344466889999
Q ss_pred eecccchhhhc
Q 000080 2373 LPLKLLNFALS 2383 (2389)
Q Consensus 2373 A~~~~~~~~~s 2383 (2389)
+.+|-++|++.
T Consensus 1202 ~idp~~~Wlvi 1212 (1431)
T KOG1240|consen 1202 VIDPWCNWLVI 1212 (1431)
T ss_pred EecCCceEEEE
Confidence 99999999875
No 233
>PRK04792 tolB translocation protein TolB; Provisional
Probab=97.87 E-value=0.00064 Score=86.17 Aligned_cols=198 Identities=12% Similarity=0.129 Sum_probs=104.8
Q ss_pred CcceeecCCCCCCeEEEEec---CCc-EEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEE--
Q 000080 41 TSTIDWLPDFAGYSWVAYGA---SSL-LVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAA-- 114 (2389)
Q Consensus 41 ~~ai~wlpD~~G~~~vAYas---g~~-vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaA-- 114 (2389)
...+.|+|| | .++||.+ +.. |.+..+. .+.. . ++-...+ .+...+|||| +..|+.
T Consensus 220 ~~~p~wSPD--G-~~La~~s~~~g~~~L~~~dl~---tg~~-~------~lt~~~g---~~~~~~wSPD---G~~La~~~ 280 (448)
T PRK04792 220 LMSPAWSPD--G-RKLAYVSFENRKAEIFVQDIY---TQVR-E------KVTSFPG---INGAPRFSPD---GKKLALVL 280 (448)
T ss_pred ccCceECCC--C-CEEEEEEecCCCcEEEEEECC---CCCe-E------EecCCCC---CcCCeeECCC---CCEEEEEE
Confidence 347899999 7 4888874 332 4444422 2211 1 1111111 2457899998 666774
Q ss_pred ecCCeEEEEeeCCCCCCCCccceeeEEec-ccceEEEEeecCCCCeEEEEecc---eEEee--ccCCcEEEEEEeecccc
Q 000080 115 ASENCIFVFAHDSASSKGSFCWSQNAILV-QGTKVEAIEWTGSGDGIVAGGME---TVLWK--KKNTLWEIAWKFKENYP 188 (2389)
Q Consensus 115 SyDntIRVw~~d~~~~kgd~~W~~~~tL~-hssTV~sIAWSpdG~rLaSggdD---V~IW~--~~~s~Wecvwt~~~~~~ 188 (2389)
+.++...||.-+. ..+. ...++ +...+...+|+|||++|+..++. .+||. ..++.++.+. ..+
T Consensus 281 ~~~g~~~Iy~~dl--~tg~-----~~~lt~~~~~~~~p~wSpDG~~I~f~s~~~g~~~Iy~~dl~~g~~~~Lt-~~g--- 349 (448)
T PRK04792 281 SKDGQPEIYVVDI--ATKA-----LTRITRHRAIDTEPSWHPDGKSLIFTSERGGKPQIYRVNLASGKVSRLT-FEG--- 349 (448)
T ss_pred eCCCCeEEEEEEC--CCCC-----eEECccCCCCccceEECCCCCEEEEEECCCCCceEEEEECCCCCEEEEe-cCC---
Confidence 3356666665541 1121 11233 34456778999999999976652 45554 4556666552 111
Q ss_pred ceEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccC
Q 000080 189 QNLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQR 267 (2389)
Q Consensus 189 ~~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~ 267 (2389)
......+|||||. +|.++.... .--++++.-++.. ...+. ....+ ....|+| ||+.
T Consensus 350 ~~~~~~~~SpDG~~l~~~~~~~g---------~~~I~~~dl~~g~-~~~lt-~~~~d-~~ps~sp--------dG~~--- 406 (448)
T PRK04792 350 EQNLGGSITPDGRSMIMVNRTNG---------KFNIARQDLETGA-MQVLT-STRLD-ESPSVAP--------NGTM--- 406 (448)
T ss_pred CCCcCeeECCCCCEEEEEEecCC---------ceEEEEEECCCCC-eEEcc-CCCCC-CCceECC--------CCCE---
Confidence 1223568999999 766654211 0112222211111 11111 11122 2347999 6665
Q ss_pred ceEEeeecCCeEEEEEeecCCcccc
Q 000080 268 HVLLTCCLDGTVRLWCEMDSGKTRK 292 (2389)
Q Consensus 268 nILAScSdDgTVRLW~e~d~Gk~kk 292 (2389)
|+.++..+|.-+||-.+-.|+.++
T Consensus 407 -I~~~~~~~g~~~l~~~~~~G~~~~ 430 (448)
T PRK04792 407 -VIYSTTYQGKQVLAAVSIDGRFKA 430 (448)
T ss_pred -EEEEEecCCceEEEEEECCCCceE
Confidence 456666677767776655565543
No 234
>KOG1963 consensus WD40 repeat protein [General function prediction only]
Probab=97.87 E-value=5.9e-05 Score=98.40 Aligned_cols=132 Identities=17% Similarity=0.300 Sum_probs=97.2
Q ss_pred ccccccccccccc---cCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEee-cC-CC-ceeeEecccCCCCCCCCCCCC
Q 000080 2199 LGWETQDDFEDYV---DPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWE-FG-KD-KATATYGVLPAANVPPPYALA 2272 (2389)
Q Consensus 2199 ~~~d~~~~~~~~~---d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWD-l~-tG-k~l~Tl~vl~gh~~p~~GH~~ 2272 (2389)
+.|......+-+. ....+..+ +..+++||+++++|+|-.||.|.+|. ++ .+ +...+. + .=|.+
T Consensus 184 ~~~~v~~~~~~~~~~~~~~~Htf~--~t~~~~spn~~~~Aa~d~dGrI~vw~d~~~~~~~~t~t~--l-------HWH~~ 252 (792)
T KOG1963|consen 184 HIYFVPKHTKHTSSRDITVHHTFN--ITCVALSPNERYLAAGDSDGRILVWRDFGSSDDSETCTL--L-------HWHHD 252 (792)
T ss_pred EEEEecccceeeccchhhhhhccc--ceeEEeccccceEEEeccCCcEEEEeccccccccccceE--E-------Eeccc
Confidence 4666666444332 22233333 48899999999999999999999997 43 12 222222 1 23668
Q ss_pred CEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2273 SISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2273 ~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
.|.+++||+||..|.||+..|.+-+|+++|+++ .+.. --.+.|..+.+|| ||.+.+.. -+|+.|.|=..
T Consensus 253 ~V~~L~fS~~G~~LlSGG~E~VLv~Wq~~T~~k----qfLP--RLgs~I~~i~vS~-ds~~~sl~---~~DNqI~li~~ 321 (792)
T KOG1963|consen 253 EVNSLSFSSDGAYLLSGGREGVLVLWQLETGKK----QFLP--RLGSPILHIVVSP-DSDLYSLV---LEDNQIHLIKA 321 (792)
T ss_pred ccceeEEecCCceEeecccceEEEEEeecCCCc----cccc--ccCCeeEEEEEcC-CCCeEEEE---ecCceEEEEec
Confidence 999999999999999999999999999999853 2322 2357899999999 88888764 47999888775
No 235
>KOG2111 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=97.78 E-value=9.6e-05 Score=88.34 Aligned_cols=105 Identities=13% Similarity=0.191 Sum_probs=77.3
Q ss_pred eEEE-EeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCc-EEEeeCCCCCccCccc
Q 000080 2233 FFLV-GSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGT-VCTWQLEVGGRSNVRP 2310 (2389)
Q Consensus 2233 ~LAS-GS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgT-VkLWDl~tggrs~~k~ 2310 (2389)
+||- |-.=|+|+|=|+..-+.-.+.. ++ .|.+.|.+|+.+-+|.++||||..|| |||||.++|+ .++.
T Consensus 150 ~LafPg~k~GqvQi~dL~~~~~~~p~~-I~-------AH~s~Iacv~Ln~~Gt~vATaStkGTLIRIFdt~~g~--~l~E 219 (346)
T KOG2111|consen 150 LLAFPGFKTGQVQIVDLASTKPNAPSI-IN-------AHDSDIACVALNLQGTLVATASTKGTLIRIFDTEDGT--LLQE 219 (346)
T ss_pred EEEcCCCccceEEEEEhhhcCcCCceE-EE-------cccCceeEEEEcCCccEEEEeccCcEEEEEEEcCCCc--Eeee
Confidence 4443 4455778888876444311111 12 46799999999999999999999999 7999999985 2233
Q ss_pred ceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080 2311 MESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2311 l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
++.-..| ..|++++||| ++++||.+ |+-+||.|..+.
T Consensus 220 ~RRG~d~-A~iy~iaFSp-~~s~Lavs---SdKgTlHiF~l~ 256 (346)
T KOG2111|consen 220 LRRGVDR-ADIYCIAFSP-NSSWLAVS---SDKGTLHIFSLR 256 (346)
T ss_pred eecCCch-heEEEEEeCC-CccEEEEE---cCCCeEEEEEee
Confidence 3332223 5689999999 99999986 799999999974
No 236
>KOG2111 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=97.77 E-value=8.4e-05 Score=88.83 Aligned_cols=75 Identities=12% Similarity=0.132 Sum_probs=65.8
Q ss_pred eEEEEEEcCCCCeEEEEeCCCc-EEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTH-IYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgT-IRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
.|..|+.+-+|..+||+|..|| |||||..+|+.++.++ .|- ..+.|++++||||+.+||.+|+-|||.+..
T Consensus 183 ~Iacv~Ln~~Gt~vATaStkGTLIRIFdt~~g~~l~E~R--RG~------d~A~iy~iaFSp~~s~LavsSdKgTlHiF~ 254 (346)
T KOG2111|consen 183 DIACVALNLQGTLVATASTKGTLIRIFDTEDGTLLQELR--RGV------DRADIYCIAFSPNSSWLAVSSDKGTLHIFS 254 (346)
T ss_pred ceeEEEEcCCccEEEEeccCcEEEEEEEcCCCcEeeeee--cCC------chheEEEEEeCCCccEEEEEcCCCeEEEEE
Confidence 3588999999999999999988 5999999999998886 232 226799999999999999999999999999
Q ss_pred CCCC
Q 000080 2300 LEVG 2303 (2389)
Q Consensus 2300 l~tg 2303 (2389)
++..
T Consensus 255 l~~~ 258 (346)
T KOG2111|consen 255 LRDT 258 (346)
T ss_pred eecC
Confidence 9763
No 237
>KOG4547 consensus WD40 repeat-containing protein [General function prediction only]
Probab=97.76 E-value=0.00024 Score=89.98 Aligned_cols=130 Identities=11% Similarity=0.066 Sum_probs=100.9
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
..|.++..+.+...|-|++.|+.+-.|+...++.++.+.. -...|.+++++|||+.|++|| ++|++||
T Consensus 103 ~~v~~~~~~~~~~ciyS~~ad~~v~~~~~~~~~~~~~~~~----------~~~~~~sl~is~D~~~l~~as--~~ik~~~ 170 (541)
T KOG4547|consen 103 GNVNEILDAQRLGCIYSVGADLKVVYILEKEKVIIRIWKE----------QKPLVSSLCISPDGKILLTAS--RQIKVLD 170 (541)
T ss_pred CcceeeecccccCceEecCCceeEEEEecccceeeeeecc----------CCCccceEEEcCCCCEEEecc--ceEEEEE
Confidence 3568889999999999999999999999998888888763 135699999999999999998 5799999
Q ss_pred CCCCCccCcccceeeeecCCCeeEEEEecCC-----CCEEEEeecCCCCCeEEEeeCCCCCC-Cc-eEEEEeecCcE
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSS-----GSVIAAAGHSSNGINVVVWDTLAPPT-SS-RASITCHEGLY 2369 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~D-----GslLASAG~sS~D~TVrLWD~l~~tg-~~-v~sL~GH~~~V 2369 (2389)
++++ +.+.++.||.+.|++++|.. + |.++.++. ..++-|.+|-+..... +. .++|..-.-+|
T Consensus 171 ~~~k-----evv~~ftgh~s~v~t~~f~~-~~~g~~G~~vLssa--~~~r~i~~w~v~~~~kkks~~~sl~~~dipv 239 (541)
T KOG4547|consen 171 IETK-----EVVITFTGHGSPVRTLSFTT-LIDGIIGKYVLSSA--AAERGITVWVVEKEDKKKSLSCSLTVPDIPV 239 (541)
T ss_pred ccCc-----eEEEEecCCCcceEEEEEEE-eccccccceeeecc--ccccceeEEEEEcccccchhheeeccCCCCe
Confidence 9996 57899999999999999998 5 55555532 3566688887743222 22 45665443333
No 238
>KOG3881 consensus Uncharacterized conserved protein [Function unknown]
Probab=97.75 E-value=0.0002 Score=87.46 Aligned_cols=121 Identities=12% Similarity=0.082 Sum_probs=100.0
Q ss_pred eeEEEEEEcCC--CCeEEEEeCCCcEEEeecCCCc-eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEE
Q 000080 2220 ISTRAFSSHPL--RPFFLVGSSNTHIYLWEFGKDK-ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVC 2296 (2389)
Q Consensus 2220 i~VrsVAFsPd--G~~LASGS~DgTIRLWDl~tGk-~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVk 2296 (2389)
|.+.++.|-|. ...||+++.=+.||+||.+.++ .+.+|.. -...|+++...|+|+++.+|..-|.+.
T Consensus 203 vW~tdi~Fl~g~~~~~fat~T~~hqvR~YDt~~qRRPV~~fd~----------~E~~is~~~l~p~gn~Iy~gn~~g~l~ 272 (412)
T KOG3881|consen 203 VWITDIRFLEGSPNYKFATITRYHQVRLYDTRHQRRPVAQFDF----------LENPISSTGLTPSGNFIYTGNTKGQLA 272 (412)
T ss_pred eeeccceecCCCCCceEEEEecceeEEEecCcccCcceeEecc----------ccCcceeeeecCCCcEEEEecccchhh
Confidence 34567899998 7789999999999999999886 5666642 246799999999999999999999999
Q ss_pred EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceE
Q 000080 2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRA 2360 (2389)
Q Consensus 2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~ 2360 (2389)
..|++++. .....+.|.++.+++|.-+| ++.+||++| -|+.|||.|+ .+.+.++
T Consensus 273 ~FD~r~~k----l~g~~~kg~tGsirsih~hp-~~~~las~G---LDRyvRIhD~--ktrkll~ 326 (412)
T KOG3881|consen 273 KFDLRGGK----LLGCGLKGITGSIRSIHCHP-THPVLASCG---LDRYVRIHDI--KTRKLLH 326 (412)
T ss_pred eecccCce----eeccccCCccCCcceEEEcC-CCceEEeec---cceeEEEeec--ccchhhh
Confidence 99999862 23345788899999999999 889999986 8999999997 3444443
No 239
>KOG2321 consensus WD40 repeat protein [General function prediction only]
Probab=97.71 E-value=0.00014 Score=91.44 Aligned_cols=146 Identities=15% Similarity=0.209 Sum_probs=105.0
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCC--CCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEE
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAA--NVPPPYALASISALQFDHYGHRFASAALDGTVCT 2297 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh--~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkL 2297 (2389)
..++.|..+|-..+|++|+.||.|..||.++...+.++.. +-+ ..|-......|+++.|+-||=.+|.|..+|.|.|
T Consensus 176 ~~lN~v~in~~hgLla~Gt~~g~VEfwDpR~ksrv~~l~~-~~~v~s~pg~~~~~svTal~F~d~gL~~aVGts~G~v~i 254 (703)
T KOG2321|consen 176 GELNVVSINEEHGLLACGTEDGVVEFWDPRDKSRVGTLDA-ASSVNSHPGGDAAPSVTALKFRDDGLHVAVGTSTGSVLI 254 (703)
T ss_pred ccceeeeecCccceEEecccCceEEEecchhhhhheeeec-ccccCCCccccccCcceEEEecCCceeEEeeccCCcEEE
Confidence 3458889999999999999999999999988877766641 111 0111112346999999999999999999999999
Q ss_pred eeCCCCCccCccccee-eeecCCCeeEEEEecC-CCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeec
Q 000080 2298 WQLEVGGRSNVRPMES-CLCFSSHAMDVSYITS-SGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPL 2375 (2389)
Q Consensus 2298 WDl~tggrs~~k~l~t-l~gHs~~V~sVAFSP~-DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~ 2375 (2389)
+|+++. +|+.. -.+-.-+|..+.|.+. ++..|+|. +-+.+||||- .+|+...+++ -+..++-+++-
T Consensus 255 yDLRa~-----~pl~~kdh~~e~pi~~l~~~~~~~q~~v~S~----Dk~~~kiWd~--~~Gk~~asiE-pt~~lND~C~~ 322 (703)
T KOG2321|consen 255 YDLRAS-----KPLLVKDHGYELPIKKLDWQDTDQQNKVVSM----DKRILKIWDE--CTGKPMASIE-PTSDLNDFCFV 322 (703)
T ss_pred EEcccC-----CceeecccCCccceeeecccccCCCceEEec----chHHhhhccc--ccCCceeecc-ccCCcCceeee
Confidence 999985 34322 2233456778888874 24577774 7789999996 4666666665 33346666666
Q ss_pred ccc
Q 000080 2376 KLL 2378 (2389)
Q Consensus 2376 ~~~ 2378 (2389)
|.+
T Consensus 323 p~s 325 (703)
T KOG2321|consen 323 PGS 325 (703)
T ss_pred cCC
Confidence 554
No 240
>KOG1517 consensus Guanine nucleotide binding protein MIP1 [Cell cycle control, cell division, chromosome partitioning]
Probab=97.71 E-value=0.00029 Score=93.07 Aligned_cols=140 Identities=16% Similarity=0.152 Sum_probs=99.6
Q ss_pred EEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEEC-CCCCEEEEEeCCCcEEEeeCCCC
Q 000080 2225 FSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFD-HYGHRFASAALDGTVCTWQLEVG 2303 (2389)
Q Consensus 2225 VAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFS-PDG~~LASgS~DgTVkLWDl~tg 2303 (2389)
++|......|+++|+=..|||||..+.+.++.. |.|...-|+++.-+ +.|+.+|.|-.||.||++|.+..
T Consensus 1171 ~dWqQ~~G~Ll~tGd~r~IRIWDa~~E~~~~di---------P~~s~t~vTaLS~~~~~gn~i~AGfaDGsvRvyD~R~a 1241 (1387)
T KOG1517|consen 1171 VDWQQQSGHLLVTGDVRSIRIWDAHKEQVVADI---------PYGSSTLVTALSADLVHGNIIAAGFADGSVRVYDRRMA 1241 (1387)
T ss_pred eehhhhCCeEEecCCeeEEEEEecccceeEeec---------ccCCCccceeecccccCCceEEEeecCCceEEeecccC
Confidence 477777777777778899999999876666554 13455678888665 44799999999999999999986
Q ss_pred CccCcccceeeeecCCC--eeEEEEecCCCCE-EEEeecCCCCCeEEEeeCCCCCCCceEEEEeec--C-cEEEEeeccc
Q 000080 2304 GRSNVRPMESCLCFSSH--AMDVSYITSSGSV-IAAAGHSSNGINVVVWDTLAPPTSSRASITCHE--G-LYDLFLPLKL 2377 (2389)
Q Consensus 2304 grs~~k~l~tl~gHs~~--V~sVAFSP~DGsl-LASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~--~-~V~svA~~~~ 2377 (2389)
.+ ...+.....|+.. |..+.+-+ .|-. |+|| |.||.|++||+..+.....-++..|. | ..+++..|+.
T Consensus 1242 ~~--ds~v~~~R~h~~~~~Iv~~slq~-~G~~elvSg---s~~G~I~~~DlR~~~~e~~~~iv~~~~yGs~lTal~VH~h 1315 (1387)
T KOG1517|consen 1242 PP--DSLVCVYREHNDVEPIVHLSLQR-QGLGELVSG---SQDGDIQLLDLRMSSKETFLTIVAHWEYGSALTALTVHEH 1315 (1387)
T ss_pred Cc--cccceeecccCCcccceeEEeec-CCCcceeee---ccCCeEEEEecccCcccccceeeeccccCccceeeeeccC
Confidence 31 1356677889988 99999998 4433 7775 69999999998643333333334343 3 2666666665
Q ss_pred ch
Q 000080 2378 LN 2379 (2389)
Q Consensus 2378 ~~ 2379 (2389)
-+
T Consensus 1316 ap 1317 (1387)
T KOG1517|consen 1316 AP 1317 (1387)
T ss_pred CC
Confidence 43
No 241
>KOG1963 consensus WD40 repeat protein [General function prediction only]
Probab=97.71 E-value=0.00029 Score=92.17 Aligned_cols=142 Identities=11% Similarity=0.117 Sum_probs=103.2
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe-eCC
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW-QLE 2301 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW-Dl~ 2301 (2389)
+.|.+++.|.+.+-. .+..+.+|++.++.. .+.. ..-+ --|+-.+++++|||.|+.+|+|..||.|.+| |..
T Consensus 164 ~~I~~~~~ge~~~i~-~~~~~~~~~v~~~~~-~~~~-~~~~----~~Htf~~t~~~~spn~~~~Aa~d~dGrI~vw~d~~ 236 (792)
T KOG1963|consen 164 KSIVDNNSGEFKGIV-HMCKIHIYFVPKHTK-HTSS-RDIT----VHHTFNITCVALSPNERYLAAGDSDGRILVWRDFG 236 (792)
T ss_pred ccEEEcCCceEEEEE-EeeeEEEEEecccce-eecc-chhh----hhhcccceeEEeccccceEEEeccCCcEEEEeccc
Confidence 456899998876654 566799999987662 2211 0111 1255558999999999999999999999999 444
Q ss_pred CCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080 2302 VGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus 2302 tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
..+.+ .....+.-|...|.+++|++ ||.+|.||| ..+...+|.+ .+++ .+=|.-=.+.|..+..|||++-
T Consensus 237 ~~~~~--~t~t~lHWH~~~V~~L~fS~-~G~~LlSGG---~E~VLv~Wq~--~T~~-kqfLPRLgs~I~~i~vS~ds~~ 306 (792)
T KOG1963|consen 237 SSDDS--ETCTLLHWHHDEVNSLSFSS-DGAYLLSGG---REGVLVLWQL--ETGK-KQFLPRLGSPILHIVVSPDSDL 306 (792)
T ss_pred ccccc--ccceEEEecccccceeEEec-CCceEeecc---cceEEEEEee--cCCC-cccccccCCeeEEEEEcCCCCe
Confidence 11111 23456778999999999999 999999986 7899999998 4444 3444445566888888888863
No 242
>KOG4227 consensus WD40 repeat protein [General function prediction only]
Probab=97.67 E-value=0.00037 Score=84.45 Aligned_cols=180 Identities=9% Similarity=-0.028 Sum_probs=124.1
Q ss_pred ccccceeeccccccccccccc--------cCCCCcCc---eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecc
Q 000080 2191 YAGIGASALGWETQDDFEDYV--------DPPATVEN---ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGV 2259 (2389)
Q Consensus 2191 ~~~~~Asg~~~d~~~~~~~~~--------d~~atv~n---i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~v 2259 (2389)
-+.-+||| |.|-..++|... +|+.-.+. --|.+++|....+++.||..|++|.+-|+++.+.+..+.
T Consensus 67 N~~~L~SG-GDD~~~~~W~~de~~~~k~~KPI~~~~~~H~SNIF~L~F~~~N~~~~SG~~~~~VI~HDiEt~qsi~V~~- 144 (609)
T KOG4227|consen 67 NDRFLASG-GDDMHGRVWNVDELMVRKTPKPIGVMEHPHRSNIFSLEFDLENRFLYSGERWGTVIKHDIETKQSIYVAN- 144 (609)
T ss_pred CCeEEeec-CCcceeeeechHHHHhhcCCCCceeccCccccceEEEEEccCCeeEecCCCcceeEeeecccceeeeeec-
Confidence 35567777 777777777542 22221110 124899999999999999999999999999988777663
Q ss_pred cCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeec
Q 000080 2260 LPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGH 2339 (2389)
Q Consensus 2260 l~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~ 2339 (2389)
|+ ...+.|+.+.-+|-.+.||+.+.|+.|.+||++.. .++-...-+..-.+.-+++-|+|-.-.+||++
T Consensus 145 ---~~----~~~~~VY~m~~~P~DN~~~~~t~~~~V~~~D~Rd~--~~~~~~~~~AN~~~~F~t~~F~P~~P~Li~~~-- 213 (609)
T KOG4227|consen 145 ---EN----NNRGDVYHMDQHPTDNTLIVVTRAKLVSFIDNRDR--QNPISLVLPANSGKNFYTAEFHPETPALILVN-- 213 (609)
T ss_pred ---cc----CcccceeecccCCCCceEEEEecCceEEEEeccCC--CCCCceeeecCCCccceeeeecCCCceeEEec--
Confidence 32 12358999999999999999999999999999864 12222233334445667899999777889887
Q ss_pred CCCCCeEEEeeCCCCCCCce-----EEEEeecCcEEEEeecccchhhhcc
Q 000080 2340 SSNGINVVVWDTLAPPTSSR-----ASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2340 sS~D~TVrLWD~l~~tg~~v-----~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
++-+-+-|||...+..... ..|+.....--++-+++.|+-.|+-
T Consensus 214 -~~~~G~~~~D~R~~~~~~~~~~~~~~L~~~~~~~M~~~~~~~G~Q~msi 262 (609)
T KOG4227|consen 214 -SETGGPNVFDRRMQARPVYQRSMFKGLPQENTEWMGSLWSPSGNQFMSI 262 (609)
T ss_pred -cccCCCCceeeccccchHHhhhccccCcccchhhhheeeCCCCCeehhh
Confidence 4566689999865443222 1232211111366788888877764
No 243
>PF04762 IKI3: IKI3 family; InterPro: IPR006849 Members of this family are components of the elongator multi-subunit component of a novel RNA polymerase II holoenzyme for transcriptional elongation [].
Probab=97.67 E-value=0.0057 Score=84.07 Aligned_cols=238 Identities=17% Similarity=0.310 Sum_probs=140.7
Q ss_pred CCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCccc-ccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEE-
Q 000080 37 PTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQ-EEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAA- 114 (2389)
Q Consensus 37 p~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~-~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaA- 114 (2389)
+....-.+.+++|-..+ .+|+++|.-+++.-=|+|... .|.+ |.-| .-|.+.+|||| +|++|
T Consensus 74 ~~~~ivs~~yl~d~~~l-~~~~~~Gdi~~~~~~~~~~~~~~E~V----------G~vd-~GI~a~~WSPD----~Ella~ 137 (928)
T PF04762_consen 74 PNDKIVSFQYLADSESL-CIALASGDIILVREDPDPDEDEIEIV----------GSVD-SGILAASWSPD----EELLAL 137 (928)
T ss_pred CCCcEEEEEeccCCCcE-EEEECCceEEEEEccCCCCCceeEEE----------EEEc-CcEEEEEECCC----cCEEEE
Confidence 33444555666775553 788888888888652222222 1222 3333 36999999998 67664
Q ss_pred -ecCCeEEEEeeC--C-------CCCCC-----CccceeeEEec--------------------------ccceEEEEee
Q 000080 115 -ASENCIFVFAHD--S-------ASSKG-----SFCWSQNAILV--------------------------QGTKVEAIEW 153 (2389)
Q Consensus 115 -SyDntIRVw~~d--~-------~~~kg-----d~~W~~~~tL~--------------------------hssTV~sIAW 153 (2389)
..++++-+-..+ + ..+-+ +..|..+.|=. ....--.|+|
T Consensus 138 vT~~~~l~~mt~~fd~i~E~~l~~~~~~~~~~VsVGWGkKeTQF~Gs~gK~aa~~~~~p~~~~~d~~~~s~dd~~~~ISW 217 (928)
T PF04762_consen 138 VTGEGNLLLMTRDFDPISEVPLDSDDFGESKHVSVGWGKKETQFHGSAGKAAARQLRDPTVPKVDEGKLSWDDGRVRISW 217 (928)
T ss_pred EeCCCEEEEEeccceEEEEeecCccccCCCceeeeccCcccCccCcchhhhhhhhccCCCCCccccCccccCCCceEEEE
Confidence 566677665321 0 00111 12466653331 1112346999
Q ss_pred cCCCCeEEEEec----c----eEEeeccCCcEEEEEEeeccccceEE--EEeecCCCc-eEeeecccccccCCCCCCCce
Q 000080 154 TGSGDGIVAGGM----E----TVLWKKKNTLWEIAWKFKENYPQNLV--SATWSIEGP-SATAASMSQLDLLGPKEAGKC 222 (2389)
Q Consensus 154 SpdG~rLaSggd----D----V~IW~~~~s~Wecvwt~~~~~~~~iv--svaWSpdG~-fATag~dikf~~~~~~~~~kp 222 (2389)
-+||.+.|..+- + ++||++. + +.-.++ + +.+-. .++|.|.|. +|++-+.. ...-
T Consensus 218 RGDG~yFAVss~~~~~~~~R~iRVy~Re-G--~L~stS--E-~v~gLe~~l~WrPsG~lIA~~q~~~---------~~~~ 282 (928)
T PF04762_consen 218 RGDGEYFAVSSVEPETGSRRVIRVYSRE-G--ELQSTS--E-PVDGLEGALSWRPSGNLIASSQRLP---------DRHD 282 (928)
T ss_pred CCCCcEEEEEEEEcCCCceeEEEEECCC-c--eEEecc--c-cCCCccCCccCCCCCCEEEEEEEcC---------CCcE
Confidence 999999995553 1 7799865 2 333222 2 22222 669999999 88887611 0122
Q ss_pred eEEEeeCCCccceee--cccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeecCCcccccccccCCC
Q 000080 223 VFICCSDGKSEYIKL--ELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMDSGKTRKVAKDTNDH 300 (2389)
Q Consensus 223 V~V~~~dg~~~~~~v--e~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d~Gk~kk~~~~~~d~ 300 (2389)
|..+|.+|-.--++. .......|..++|++ ..+|||-...|. |+||..-
T Consensus 283 VvFfErNGLrhgeF~l~~~~~~~~v~~l~Wn~-------------ds~iLAv~~~~~-vqLWt~~--------------- 333 (928)
T PF04762_consen 283 VVFFERNGLRHGEFTLRFDPEEEKVIELAWNS-------------DSEILAVWLEDR-VQLWTRS--------------- 333 (928)
T ss_pred EEEEecCCcEeeeEecCCCCCCceeeEEEECC-------------CCCEEEEEecCC-ceEEEee---------------
Confidence 444544443322232 234567899999998 356799987666 9999922
Q ss_pred CccceeEEEEEEEeecccccCCCCCCeEEEeeccccceeecc
Q 000080 301 KTIRRSFCVGAIIEINQALNGALGMDIVITWAKEIRCMFETG 342 (2389)
Q Consensus 301 ~~~~~sF~vaA~I~~~~~~~~~l~~~~~v~W~~~~~~vf~~~ 342 (2389)
.-|+++=-.|..+... +. ..++|=.++...+-..
T Consensus 334 ---NYHWYLKqei~~~~~~----~~-~~~~Wdpe~p~~L~v~ 367 (928)
T PF04762_consen 334 ---NYHWYLKQEIRFSSSE----SV-NFVKWDPEKPLRLHVL 367 (928)
T ss_pred ---CCEEEEEEEEEccCCC----CC-CceEECCCCCCEEEEE
Confidence 2788888888855511 11 1388888876654444
No 244
>KOG1272 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=97.66 E-value=6.7e-05 Score=92.62 Aligned_cols=109 Identities=20% Similarity=0.337 Sum_probs=83.3
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.+..+.-+|-...+-.|..+|||.||.....+.+..+. . |.+.|++||+.|+|+++||++.|+.|++||+
T Consensus 253 ~~~vm~qNP~NaVih~GhsnGtVSlWSP~skePLvKiL---c-------H~g~V~siAv~~~G~YMaTtG~Dr~~kIWDl 322 (545)
T KOG1272|consen 253 RTDVMKQNPYNAVIHLGHSNGTVSLWSPNSKEPLVKIL---C-------HRGPVSSIAVDRGGRYMATTGLDRKVKIWDL 322 (545)
T ss_pred ccchhhcCCccceEEEcCCCceEEecCCCCcchHHHHH---h-------cCCCcceEEECCCCcEEeecccccceeEeee
Confidence 34667888988899999999999999987777654432 3 5688999999999999999999999999999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
+.-. .+.++.- ...+..++||. - .+||.+ .+..|.||.=
T Consensus 323 R~~~-----ql~t~~t-p~~a~~ls~Sq-k-glLA~~----~G~~v~iw~d 361 (545)
T KOG1272|consen 323 RNFY-----QLHTYRT-PHPASNLSLSQ-K-GLLALS----YGDHVQIWKD 361 (545)
T ss_pred cccc-----ccceeec-CCCcccccccc-c-cceeee----cCCeeeeehh
Confidence 9752 2222211 24567789996 4 456642 5678999973
No 245
>KOG2315 consensus Predicted translation initiation factor related to eIF-3a [Translation, ribosomal structure and biogenesis]
Probab=97.61 E-value=0.00021 Score=90.13 Aligned_cols=130 Identities=22% Similarity=0.384 Sum_probs=93.0
Q ss_pred CCeeEEEEcCCCCCCCcEEEecC---CeEEEEeeCCCCCCCCccceeeEEe-cccceEEEEeecCCCCeEEEEecc----
Q 000080 95 LPVTSISWSPETPSIGQLAAASE---NCIFVFAHDSASSKGSFCWSQNAIL-VQGTKVEAIEWTGSGDGIVAGGME---- 166 (2389)
Q Consensus 95 ~dVk~VaWSPd~~~~GeIaASyD---ntIRVw~~d~~~~kgd~~W~~~~tL-~hssTV~sIAWSpdG~rLaSggdD---- 166 (2389)
.+|-+|.|+|. +.|.++.|+ -+|-||... ++ -.+ ..+++=.++-|||.|+.|+-+|++
T Consensus 271 GPVhdv~W~~s---~~EF~VvyGfMPAkvtifnlr-----~~------~v~df~egpRN~~~fnp~g~ii~lAGFGNL~G 336 (566)
T KOG2315|consen 271 GPVHDVTWSPS---GREFAVVYGFMPAKVTIFNLR-----GK------PVFDFPEGPRNTAFFNPHGNIILLAGFGNLPG 336 (566)
T ss_pred CCceEEEECCC---CCEEEEEEecccceEEEEcCC-----CC------EeEeCCCCCccceEECCCCCEEEEeecCCCCC
Confidence 58999999997 778888876 788888765 11 111 246677889999999999999996
Q ss_pred -eEEeeccCCcEEEEEEeeccccceEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCC
Q 000080 167 -TVLWKKKNTLWEIAWKFKENYPQNLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQP 244 (2389)
Q Consensus 167 -V~IW~~~~s~Wecvwt~~~~~~~~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qd 244 (2389)
+.||+..+ .+++.+.... .-+++ .|||||. |.||....|+++. +.+-||-++|..-+.+. -++.
T Consensus 337 ~mEvwDv~n--~K~i~~~~a~-~tt~~--eW~PdGe~flTATTaPRlrvd------Ng~KiwhytG~~l~~~~---f~sE 402 (566)
T KOG2315|consen 337 DMEVWDVPN--RKLIAKFKAA-NTTVF--EWSPDGEYFLTATTAPRLRVD------NGIKIWHYTGSLLHEKM---FKSE 402 (566)
T ss_pred ceEEEeccc--hhhccccccC-CceEE--EEcCCCcEEEEEeccccEEec------CCeEEEEecCceeehhh---hhHh
Confidence 88999776 7777654432 23444 8999999 8888776565555 45667777766522221 1225
Q ss_pred eeEEEecc
Q 000080 245 VSMVQWRP 252 (2389)
Q Consensus 245 Vn~V~W~P 252 (2389)
-..|.|+|
T Consensus 403 L~qv~W~P 410 (566)
T KOG2315|consen 403 LLQVEWRP 410 (566)
T ss_pred Hhheeeee
Confidence 66799999
No 246
>PF02239 Cytochrom_D1: Cytochrome D1 heme domain; PDB: 1NNO_B 1HZU_A 1N15_B 1N50_A 1GJQ_A 1BL9_B 1NIR_B 1N90_B 1HZV_A 1AOQ_A ....
Probab=97.61 E-value=0.00073 Score=84.02 Aligned_cols=129 Identities=17% Similarity=0.183 Sum_probs=85.8
Q ss_pred EEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCccccee
Q 000080 2234 FLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMES 2313 (2389)
Q Consensus 2234 LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~t 2313 (2389)
+++-..+++|.+.|..+.+.+.++.. |+ +.-..++|+|||+++.+++.||+|.++|+.++ +.+.+
T Consensus 9 ~V~~~~~~~v~viD~~t~~~~~~i~~---------~~-~~h~~~~~s~Dgr~~yv~~rdg~vsviD~~~~-----~~v~~ 73 (369)
T PF02239_consen 9 YVVERGSGSVAVIDGATNKVVARIPT---------GG-APHAGLKFSPDGRYLYVANRDGTVSVIDLATG-----KVVAT 73 (369)
T ss_dssp EEEEGGGTEEEEEETTT-SEEEEEE----------ST-TEEEEEE-TT-SSEEEEEETTSEEEEEETTSS-----SEEEE
T ss_pred EEEecCCCEEEEEECCCCeEEEEEcC---------CC-CceeEEEecCCCCEEEEEcCCCeEEEEECCcc-----cEEEE
Confidence 45677899999999999998888741 11 22245789999999999999999999999986 34555
Q ss_pred eeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEee-------cCcEEEEeecccch-hhhc
Q 000080 2314 CLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCH-------EGLYDLFLPLKLLN-FALS 2383 (2389)
Q Consensus 2314 l~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH-------~~~V~svA~~~~~~-~~~s 2383 (2389)
... .....++++|+ ||++++++. -.+++|.|+|+ .+.+.++.+... +.++..+-.++..+ |+++
T Consensus 74 i~~-G~~~~~i~~s~-DG~~~~v~n--~~~~~v~v~D~--~tle~v~~I~~~~~~~~~~~~Rv~aIv~s~~~~~fVv~ 145 (369)
T PF02239_consen 74 IKV-GGNPRGIAVSP-DGKYVYVAN--YEPGTVSVIDA--ETLEPVKTIPTGGMPVDGPESRVAAIVASPGRPEFVVN 145 (369)
T ss_dssp EE--SSEEEEEEE---TTTEEEEEE--EETTEEEEEET--TT--EEEEEE--EE-TTTS---EEEEEE-SSSSEEEEE
T ss_pred Eec-CCCcceEEEcC-CCCEEEEEe--cCCCceeEecc--ccccceeecccccccccccCCCceeEEecCCCCEEEEE
Confidence 443 34567899999 999999864 47899999997 455667766432 23556665566555 5544
No 247
>PF00400 WD40: WD domain, G-beta repeat; InterPro: IPR019781 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events.; PDB: 2ZKQ_a 3CFV_B 3CFS_B 1PEV_A 1NR0_A 1VYH_T 3RFH_A 3O2Z_T 3FRX_C 3U5G_g ....
Probab=97.61 E-value=0.00013 Score=61.44 Aligned_cols=38 Identities=21% Similarity=0.385 Sum_probs=34.7
Q ss_pred ccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEee
Q 000080 2309 RPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWD 2350 (2389)
Q Consensus 2309 k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD 2350 (2389)
+++.++.+|+..|++++|+| ++++|||+ +.|++|+|||
T Consensus 2 ~~~~~~~~h~~~i~~i~~~~-~~~~~~s~---~~D~~i~vwd 39 (39)
T PF00400_consen 2 KCVRTFRGHSSSINSIAWSP-DGNFLASG---SSDGTIRVWD 39 (39)
T ss_dssp EEEEEEESSSSSEEEEEEET-TSSEEEEE---ETTSEEEEEE
T ss_pred eEEEEEcCCCCcEEEEEEec-ccccceee---CCCCEEEEEC
Confidence 46788999999999999999 89999997 4999999998
No 248
>PF02239 Cytochrom_D1: Cytochrome D1 heme domain; PDB: 1NNO_B 1HZU_A 1N15_B 1N50_A 1GJQ_A 1BL9_B 1NIR_B 1N90_B 1HZV_A 1AOQ_A ....
Probab=97.55 E-value=0.0022 Score=79.84 Aligned_cols=136 Identities=13% Similarity=0.057 Sum_probs=84.7
Q ss_pred EEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe-CCCcEEEeeCCC
Q 000080 2224 AFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA-LDGTVCTWQLEV 2302 (2389)
Q Consensus 2224 sVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-~DgTVkLWDl~t 2302 (2389)
.+.|+|||+++..++.|+.|.++|+.+++.+++.++ | ..-+.+++||||++++++. .+++|.++|.++
T Consensus 41 ~~~~s~Dgr~~yv~~rdg~vsviD~~~~~~v~~i~~--G---------~~~~~i~~s~DG~~~~v~n~~~~~v~v~D~~t 109 (369)
T PF02239_consen 41 GLKFSPDGRYLYVANRDGTVSVIDLATGKVVATIKV--G---------GNPRGIAVSPDGKYVYVANYEPGTVSVIDAET 109 (369)
T ss_dssp EEE-TT-SSEEEEEETTSEEEEEETTSSSEEEEEE---S---------SEEEEEEE--TTTEEEEEEEETTEEEEEETTT
T ss_pred EEEecCCCCEEEEEcCCCeEEEEECCcccEEEEEec--C---------CCcceEEEcCCCCEEEEEecCCCceeEecccc
Confidence 368999999999999999999999999999988862 2 3468999999999888765 789999999998
Q ss_pred CCccCcccceeeee-------cCCCeeEEEEecCCCC-EEEEeecCCCCCeEEEeeCCCCCCCce--EEEEeecCcEEEE
Q 000080 2303 GGRSNVRPMESCLC-------FSSHAMDVSYITSSGS-VIAAAGHSSNGINVVVWDTLAPPTSSR--ASITCHEGLYDLF 2372 (2389)
Q Consensus 2303 ggrs~~k~l~tl~g-------Hs~~V~sVAFSP~DGs-lLASAG~sS~D~TVrLWD~l~~tg~~v--~sL~GH~~~V~sv 2372 (2389)
. +++++... -+..+..|..+| .+. ++++- -+-+.|.+=|+. ..+.+ ..+. -...-.-.
T Consensus 110 l-----e~v~~I~~~~~~~~~~~~Rv~aIv~s~-~~~~fVv~l---kd~~~I~vVdy~--d~~~~~~~~i~-~g~~~~D~ 177 (369)
T PF02239_consen 110 L-----EPVKTIPTGGMPVDGPESRVAAIVASP-GRPEFVVNL---KDTGEIWVVDYS--DPKNLKVTTIK-VGRFPHDG 177 (369)
T ss_dssp -------EEEEEE--EE-TTTS---EEEEEE-S-SSSEEEEEE---TTTTEEEEEETT--TSSCEEEEEEE---TTEEEE
T ss_pred c-----cceeecccccccccccCCCceeEEecC-CCCEEEEEE---ccCCeEEEEEec--cccccceeeec-cccccccc
Confidence 5 34444332 234677888888 555 55543 123444444653 22222 3332 22333456
Q ss_pred eecccchhhh
Q 000080 2373 LPLKLLNFAL 2382 (2389)
Q Consensus 2373 A~~~~~~~~~ 2382 (2389)
.+.|+|++.+
T Consensus 178 ~~dpdgry~~ 187 (369)
T PF02239_consen 178 GFDPDGRYFL 187 (369)
T ss_dssp EE-TTSSEEE
T ss_pred ccCcccceee
Confidence 7788887654
No 249
>PRK00178 tolB translocation protein TolB; Provisional
Probab=97.49 E-value=0.001 Score=83.09 Aligned_cols=118 Identities=15% Similarity=0.124 Sum_probs=80.1
Q ss_pred cEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC---CcEEEeeCCCCCccCcccceeeeecC
Q 000080 2242 HIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD---GTVCTWQLEVGGRSNVRPMESCLCFS 2318 (2389)
Q Consensus 2242 TIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D---gTVkLWDl~tggrs~~k~l~tl~gHs 2318 (2389)
.|.++|.. |...+.+. .+...+.+.+|||||++||..+.+ ..|.+||+.++.. +.+.. ..
T Consensus 180 ~l~~~d~~-g~~~~~l~----------~~~~~~~~p~wSpDG~~la~~s~~~~~~~l~~~~l~~g~~---~~l~~---~~ 242 (430)
T PRK00178 180 TLQRSDYD-GARAVTLL----------QSREPILSPRWSPDGKRIAYVSFEQKRPRIFVQNLDTGRR---EQITN---FE 242 (430)
T ss_pred EEEEECCC-CCCceEEe----------cCCCceeeeeECCCCCEEEEEEcCCCCCEEEEEECCCCCE---EEccC---CC
Confidence 58888875 44333332 123668999999999999987754 3688999988631 23322 33
Q ss_pred CCeeEEEEecCCCCEEEEeecCCCCC--eEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhh
Q 000080 2319 SHAMDVSYITSSGSVIAAAGHSSNGI--NVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus 2319 ~~V~sVAFSP~DGslLASAG~sS~D~--TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
+.+...+|+| ||+.||.+. +.++ .|.+||+ .+ +.++.+..+.......+++|+|++++
T Consensus 243 g~~~~~~~Sp-DG~~la~~~--~~~g~~~Iy~~d~--~~-~~~~~lt~~~~~~~~~~~spDg~~i~ 302 (430)
T PRK00178 243 GLNGAPAWSP-DGSKLAFVL--SKDGNPEIYVMDL--AS-RQLSRVTNHPAIDTEPFWGKDGRTLY 302 (430)
T ss_pred CCcCCeEECC-CCCEEEEEE--ccCCCceEEEEEC--CC-CCeEEcccCCCCcCCeEECCCCCEEE
Confidence 3455689999 999888532 2333 5777787 23 34566777777777888999998764
No 250
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=97.48 E-value=0.0043 Score=76.06 Aligned_cols=127 Identities=12% Similarity=0.200 Sum_probs=85.7
Q ss_pred EEEEEEcCCCCeE-EEEeCCCcEEEeecC--CCce--eeEecccCCCCCCCCCCCCCEEEEEECCCCCE-EEEEeCCCcE
Q 000080 2222 TRAFSSHPLRPFF-LVGSSNTHIYLWEFG--KDKA--TATYGVLPAANVPPPYALASISALQFDHYGHR-FASAALDGTV 2295 (2389)
Q Consensus 2222 VrsVAFsPdG~~L-ASGS~DgTIRLWDl~--tGk~--l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~-LASgS~DgTV 2295 (2389)
=|.++|||||+++ +..-.+++|.++++. +|+. +++...++.. ..+ ......|++||||++ ++|...+++|
T Consensus 194 PRh~~f~pdg~~~Yv~~e~s~~v~v~~~~~~~g~~~~~~~~~~~~~~---~~~-~~~~~~i~ispdg~~lyvsnr~~~sI 269 (345)
T PF10282_consen 194 PRHLAFSPDGKYAYVVNELSNTVSVFDYDPSDGSLTEIQTISTLPEG---FTG-ENAPAEIAISPDGRFLYVSNRGSNSI 269 (345)
T ss_dssp EEEEEE-TTSSEEEEEETTTTEEEEEEEETTTTEEEEEEEEESCETT---SCS-SSSEEEEEE-TTSSEEEEEECTTTEE
T ss_pred CcEEEEcCCcCEEEEecCCCCcEEEEeecccCCceeEEEEeeecccc---ccc-cCCceeEEEecCCCEEEEEeccCCEE
Confidence 3888999999965 556688999999998 5543 3333222221 011 136899999999986 5556688999
Q ss_pred EEeeCCC-CCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCC
Q 000080 2296 CTWQLEV-GGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTS 2357 (2389)
Q Consensus 2296 kLWDl~t-ggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~ 2357 (2389)
.++++.. .+ .++.+.........-+.++|+| ||++|+.+. -.+++|.++++...+|.
T Consensus 270 ~vf~~d~~~g--~l~~~~~~~~~G~~Pr~~~~s~-~g~~l~Va~--~~s~~v~vf~~d~~tG~ 327 (345)
T PF10282_consen 270 SVFDLDPATG--TLTLVQTVPTGGKFPRHFAFSP-DGRYLYVAN--QDSNTVSVFDIDPDTGK 327 (345)
T ss_dssp EEEEECTTTT--TEEEEEEEEESSSSEEEEEE-T-TSSEEEEEE--TTTTEEEEEEEETTTTE
T ss_pred EEEEEecCCC--ceEEEEEEeCCCCCccEEEEeC-CCCEEEEEe--cCCCeEEEEEEeCCCCc
Confidence 9999942 22 2345555554455688999999 999999875 47788999987534444
No 251
>KOG1587 consensus Cytoplasmic dynein intermediate chain [Cytoskeleton]
Probab=97.48 E-value=0.00034 Score=90.63 Aligned_cols=116 Identities=15% Similarity=0.210 Sum_probs=88.4
Q ss_pred ceeEEEEEEcCCCCeEEEEeCCCcEEEeecC-CCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEE
Q 000080 2219 NISTRAFSSHPLRPFFLVGSSNTHIYLWEFG-KDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVC 2296 (2389)
Q Consensus 2219 ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~-tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVk 2296 (2389)
..+|++|.++|=++-+...+.|.+||||.-. .-..+..+. . +.+.|++|++||-- ..||++..||.+-
T Consensus 398 ~g~v~~v~~nPF~~k~fls~gDW~vriWs~~~~~~Pl~~~~---~-------~~~~v~~vaWSptrpavF~~~d~~G~l~ 467 (555)
T KOG1587|consen 398 IGPVYAVSRNPFYPKNFLSVGDWTVRIWSEDVIASPLLSLD---S-------SPDYVTDVAWSPTRPAVFATVDGDGNLD 467 (555)
T ss_pred CcceEeeecCCCccceeeeeccceeEeccccCCCCcchhhh---h-------ccceeeeeEEcCcCceEEEEEcCCCcee
Confidence 3578999999988744444449999999975 334443332 1 34779999999996 7999999999999
Q ss_pred EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
+||+... ...|+.+..-+....+.+.+++ +|+.||.| ...|+|.+|++
T Consensus 468 iWDLl~~---~~~Pv~s~~~~~~~l~~~~~s~-~g~~lavG---d~~G~~~~~~l 515 (555)
T KOG1587|consen 468 IWDLLQD---DEEPVLSQKVCSPALTRVRWSP-NGKLLAVG---DANGTTHILKL 515 (555)
T ss_pred hhhhhcc---ccCCcccccccccccceeecCC-CCcEEEEe---cCCCcEEEEEc
Confidence 9999864 3467777655555555666776 89999986 48899999998
No 252
>KOG0309 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=97.46 E-value=0.00039 Score=89.19 Aligned_cols=194 Identities=16% Similarity=0.201 Sum_probs=120.0
Q ss_pred CcceeecCCCCCCeEEEEecCCcEEEEeCCCCccccccc--ccccceeeeeccCCC-CCeeEEEEcCCCCCCCc----EE
Q 000080 41 TSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEAL--IGPIFRQVFALSDNS-LPVTSISWSPETPSIGQ----LA 113 (2389)
Q Consensus 41 ~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~--~~p~~~Qviegh~d~-~dVk~VaWSPd~~~~Ge----Ia 113 (2389)
.+|.+-.|. | .=||-|+.-++.|.+|++|...+..+ +-|.+.+-.+-+-|. -|.|.|.|||+ .- +|
T Consensus 27 ~~a~si~p~--g-rdi~lAsr~gl~i~dld~p~~ppr~l~h~tpw~vad~qws~h~a~~~wiVsts~q----kaiiwnlA 99 (1081)
T KOG0309|consen 27 FNAVSINPS--G-RDIVLASRQGLYIIDLDDPFTPPRWLHHITPWQVADVQWSPHPAKPYWIVSTSNQ----KAIIWNLA 99 (1081)
T ss_pred ccceeeccc--c-chhhhhhhcCeEEEeccCCCCCceeeeccCcchhcceecccCCCCceeEEecCcc----hhhhhhhh
Confidence 456666676 5 35788999999999999999887653 333333322222222 34555555553 22 22
Q ss_pred EecCCeEEEEeeCCCCCCCCccceeeEEecccceEEEEeecCCCC-eEEEEecc--eEEeeccCCcEE-EEEEeeccccc
Q 000080 114 AASENCIFVFAHDSASSKGSFCWSQNAILVQGTKVEAIEWTGSGD-GIVAGGME--TVLWKKKNTLWE-IAWKFKENYPQ 189 (2389)
Q Consensus 114 ASyDntIRVw~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSpdG~-rLaSggdD--V~IW~~~~s~We-cvwt~~~~~~~ 189 (2389)
+|+++.|-++-+- |++.|-++-|+|+-. -|++|+-| |..|+..+...- .+|.....+..
T Consensus 100 ~ss~~aIef~lhg-----------------hsraitd~n~~~q~pdVlatcsvdt~vh~wd~rSp~~p~ys~~~w~s~as 162 (1081)
T KOG0309|consen 100 KSSSNAIEFVLHG-----------------HSRAITDINFNPQHPDVLATCSVDTYVHAWDMRSPHRPFYSTSSWRSAAS 162 (1081)
T ss_pred cCCccceEEEEec-----------------CccceeccccCCCCCcceeeccccccceeeeccCCCcceeeeecccccCc
Confidence 3445555444432 788999999999875 67799988 899996543321 11111111111
Q ss_pred eEEEEeecC-CCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccC
Q 000080 190 NLVSATWSI-EGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQR 267 (2389)
Q Consensus 190 ~ivsvaWSp-dG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~ 267 (2389)
.|.|+- ++. +|+.-+ +-++||.......-.+....|...||++..+- ...
T Consensus 163 ---qVkwnyk~p~vlasshg-------------~~i~vwd~r~gs~pl~s~K~~vs~vn~~~fnr------------~~~ 214 (1081)
T KOG0309|consen 163 ---QVKWNYKDPNVLASSHG-------------NDIFVWDLRKGSTPLCSLKGHVSSVNSIDFNR------------FKY 214 (1081)
T ss_pred ---eeeecccCcchhhhccC-------------CceEEEeccCCCcceEEecccceeeehHHHhh------------hhh
Confidence 347774 455 775533 22446643323333445556999999999986 234
Q ss_pred ceEEeeecCCeEEEEEeec
Q 000080 268 HVLLTCCLDGTVRLWCEMD 286 (2389)
Q Consensus 268 nILAScSdDgTVRLW~e~d 286 (2389)
..++||+-|+|||.|++.-
T Consensus 215 s~~~s~~~d~tvkfw~y~k 233 (1081)
T KOG0309|consen 215 SEIMSSSNDGTVKFWDYSK 233 (1081)
T ss_pred hhhcccCCCCceeeecccc
Confidence 5699999999999999874
No 253
>KOG3881 consensus Uncharacterized conserved protein [Function unknown]
Probab=97.42 E-value=0.0009 Score=81.93 Aligned_cols=151 Identities=13% Similarity=0.116 Sum_probs=113.8
Q ss_pred EEEEEEcCCCC-eEEEEeCC--CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC--CCEEEEEeCCCcEE
Q 000080 2222 TRAFSSHPLRP-FFLVGSSN--THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY--GHRFASAALDGTVC 2296 (2389)
Q Consensus 2222 VrsVAFsPdG~-~LASGS~D--gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD--G~~LASgS~DgTVk 2296 (2389)
+..+--+|.-+ ++|+|+-. ..+++||+.+++.+-+...+|-.+ ...----|++++.|-|. -..||++..-+.||
T Consensus 151 ~~~~r~~~~~p~Iva~GGke~~n~lkiwdle~~~qiw~aKNvpnD~-L~LrVPvW~tdi~Fl~g~~~~~fat~T~~hqvR 229 (412)
T KOG3881|consen 151 LYDVRQTDTDPYIVATGGKENINELKIWDLEQSKQIWSAKNVPNDR-LGLRVPVWITDIRFLEGSPNYKFATITRYHQVR 229 (412)
T ss_pred eeeeccCCCCCceEecCchhcccceeeeecccceeeeeccCCCCcc-ccceeeeeeccceecCCCCCceEEEEecceeEE
Confidence 45566677666 45669988 889999998875543332222111 00001157889999988 89999999999999
Q ss_pred EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEE-EEeecCcEEEEeec
Q 000080 2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRAS-ITCHEGLYDLFLPL 2375 (2389)
Q Consensus 2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~s-L~GH~~~V~svA~~ 2375 (2389)
++|.+.+ | +|+.++.--+..+.+++.-| +|+.|.+| ..-+.+...|+ ..++...+ +.|-++.+++|--+
T Consensus 230 ~YDt~~q-R---RPV~~fd~~E~~is~~~l~p-~gn~Iy~g---n~~g~l~~FD~--r~~kl~g~~~kg~tGsirsih~h 299 (412)
T KOG3881|consen 230 LYDTRHQ-R---RPVAQFDFLENPISSTGLTP-SGNFIYTG---NTKGQLAKFDL--RGGKLLGCGLKGITGSIRSIHCH 299 (412)
T ss_pred EecCccc-C---cceeEeccccCcceeeeecC-CCcEEEEe---cccchhheecc--cCceeeccccCCccCCcceEEEc
Confidence 9999987 4 68888777789999999999 99999986 35678999998 35555555 88889999999888
Q ss_pred ccchhhhc
Q 000080 2376 KLLNFALS 2383 (2389)
Q Consensus 2376 ~~~~~~~s 2383 (2389)
|.+.++.|
T Consensus 300 p~~~~las 307 (412)
T KOG3881|consen 300 PTHPVLAS 307 (412)
T ss_pred CCCceEEe
Confidence 88877665
No 254
>KOG2315 consensus Predicted translation initiation factor related to eIF-3a [Translation, ribosomal structure and biogenesis]
Probab=97.33 E-value=0.0052 Score=78.15 Aligned_cols=225 Identities=18% Similarity=0.179 Sum_probs=142.2
Q ss_pred CCCCCCCCCCcccccCCccCCCc---cccCCCCcccccCCcccccccccCCCccccCccccccccccccceeeccccccc
Q 000080 2129 DWPQNGWAGSESTPVPTFVSPGV---GLGSNKGAHLGLGGATIGVGSLARPGRDLTGGLAFGIPGYAGIGASALGWETQD 2205 (2389)
Q Consensus 2129 ~~~~~~~~~~~s~p~~~~~s~~~---g~~~~~g~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~g~~~~~Asg~~~d~~~ 2205 (2389)
+| .--|.-+||-- ---|+-.| -+++.++-.-.|....|++..+...+..-. .|+=+||..|+-|++--|.-.+
T Consensus 128 ~W-~~qfs~dEsl~-arlv~nev~f~~~~~f~~~~~kl~~~~i~~f~lSpgp~~~~--vAvyvPe~kGaPa~vri~~~~~ 203 (566)
T KOG2315|consen 128 GW-VPQFSIDESLA-ARLVSNEVQFYDLGSFKTIQHKLSVSGITMLSLSPGPEPPF--VAVYVPEKKGAPASVRIYKYPE 203 (566)
T ss_pred Cc-ccccccchhhh-hhhhcceEEEEecCCccceeeeeeccceeeEEecCCCCCce--EEEEccCCCCCCcEEEEecccc
Confidence 35 44566677622 11122222 234566666666666666666655433332 3667899999988884443331
Q ss_pred cccccccCCCCc--CceeEEEEEEcCCCC---eEEEEeCC---------CcEEEeecCCCceeeEecccCCCCCCCCCCC
Q 000080 2206 DFEDYVDPPATV--ENISTRAFSSHPLRP---FFLVGSSN---------THIYLWEFGKDKATATYGVLPAANVPPPYAL 2271 (2389)
Q Consensus 2206 ~~~~~~d~~atv--~ni~VrsVAFsPdG~---~LASGS~D---------gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~ 2271 (2389)
... ..+++.- =-..--.+.|++-|. .|++.--| .++++-++...++...+. . .
T Consensus 204 ~~~--~~~~a~ksFFkadkvqm~WN~~gt~LLvLastdVDktn~SYYGEq~Lyll~t~g~s~~V~L~---k--------~ 270 (566)
T KOG2315|consen 204 EGQ--HQPVANKSFFKADKVQMKWNKLGTALLVLASTDVDKTNASYYGEQTLYLLATQGESVSVPLL---K--------E 270 (566)
T ss_pred ccc--cchhhhccccccceeEEEeccCCceEEEEEEEeecCCCccccccceEEEEEecCceEEEecC---C--------C
Confidence 111 0111110 000112456777777 23333334 478888886334443332 1 3
Q ss_pred CCEEEEEECCCCCEEEEEeC--CCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEe
Q 000080 2272 ASISALQFDHYGHRFASAAL--DGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVW 2349 (2389)
Q Consensus 2272 ~~V~sVaFSPDG~~LASgS~--DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLW 2349 (2389)
+.|++|.|||+|+-||...+ =-+|.+.|++- .++..+ -++.=+++-|+| .|++|+-||||..-|.|.+|
T Consensus 271 GPVhdv~W~~s~~EF~VvyGfMPAkvtifnlr~------~~v~df--~egpRN~~~fnp-~g~ii~lAGFGNL~G~mEvw 341 (566)
T KOG2315|consen 271 GPVHDVTWSPSGREFAVVYGFMPAKVTIFNLRG------KPVFDF--PEGPRNTAFFNP-HGNIILLAGFGNLPGDMEVW 341 (566)
T ss_pred CCceEEEECCCCCEEEEEEecccceEEEEcCCC------CEeEeC--CCCCccceEECC-CCCEEEEeecCCCCCceEEE
Confidence 77999999999999988664 57889999973 355554 234556788999 99999999999999999999
Q ss_pred eCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080 2350 DTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2350 D~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
|+ .+.+++.++.+- +.+.+.-+|+|.|+|.
T Consensus 342 Dv--~n~K~i~~~~a~--~tt~~eW~PdGe~flT 371 (566)
T KOG2315|consen 342 DV--PNRKLIAKFKAA--NTTVFEWSPDGEYFLT 371 (566)
T ss_pred ec--cchhhccccccC--CceEEEEcCCCcEEEE
Confidence 98 467778887754 3678899999999986
No 255
>KOG1334 consensus WD40 repeat protein [General function prediction only]
Probab=97.32 E-value=0.00063 Score=84.81 Aligned_cols=117 Identities=11% Similarity=0.153 Sum_probs=95.2
Q ss_pred EEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC--CCEEEEEeCCCcEEEee
Q 000080 2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY--GHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD--G~~LASgS~DgTVkLWD 2299 (2389)
|.+|.|+..|..|+|||+|.+|-+|||.+++.+..|. .||...|.+-.|=|. .+.+++.+.||.||+=.
T Consensus 145 VntV~FN~~Gd~l~SgSDD~~vv~WdW~~~~~~l~f~---------SGH~~NvfQaKFiP~s~d~ti~~~s~dgqvr~s~ 215 (559)
T KOG1334|consen 145 VNTVHFNQRGDVLASGSDDLQVVVWDWVSGSPKLSFE---------SGHCNNVFQAKFIPFSGDRTIVTSSRDGQVRVSE 215 (559)
T ss_pred cceeeecccCceeeccCccceEEeehhhccCcccccc---------cccccchhhhhccCCCCCcCceeccccCceeeee
Confidence 4677999999999999999999999999998877764 378888999999776 48999999999999876
Q ss_pred CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
+-..+ ...-...+..|.++|.-+|.-|++-..+.|+| +|+.|.=-|+.
T Consensus 216 i~~t~--~~e~t~rl~~h~g~vhklav~p~sp~~f~S~g---eD~~v~~~Dlr 263 (559)
T KOG1334|consen 216 ILETG--YVENTKRLAPHEGPVHKLAVEPDSPKPFLSCG---EDAVVFHIDLR 263 (559)
T ss_pred ecccc--ceecceecccccCccceeeecCCCCCcccccc---cccceeeeeec
Confidence 64432 11223445568899999999997777888874 99999988873
No 256
>KOG3914 consensus WD repeat protein WDR4 [Function unknown]
Probab=97.29 E-value=0.00037 Score=85.48 Aligned_cols=73 Identities=12% Similarity=0.167 Sum_probs=61.6
Q ss_pred EEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCC
Q 000080 2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus 2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~ 2301 (2389)
+..|+++||+++|+++-.|.+||+=.+..---+.+| ..||...|..++.-++- .|+|||+|+||++||++
T Consensus 154 l~dVavS~D~~~IitaDRDEkIRvs~ypa~f~Iesf---------clGH~eFVS~isl~~~~-~LlS~sGD~tlr~Wd~~ 223 (390)
T KOG3914|consen 154 LLDVAVSPDDQFIITADRDEKIRVSRYPATFVIESF---------CLGHKEFVSTISLTDNY-LLLSGSGDKTLRLWDIT 223 (390)
T ss_pred hheeeecCCCCEEEEecCCceEEEEecCcccchhhh---------ccccHhheeeeeeccCc-eeeecCCCCcEEEEecc
Confidence 478899999999999999999999776433334444 36899999999998775 59999999999999999
Q ss_pred CCC
Q 000080 2302 VGG 2304 (2389)
Q Consensus 2302 tgg 2304 (2389)
+|.
T Consensus 224 sgk 226 (390)
T KOG3914|consen 224 SGK 226 (390)
T ss_pred cCC
Confidence 983
No 257
>PLN02919 haloacid dehalogenase-like hydrolase family protein
Probab=97.28 E-value=0.0033 Score=87.48 Aligned_cols=119 Identities=12% Similarity=0.091 Sum_probs=82.1
Q ss_pred EEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccC--CCCCCCCC---------CCCCEEEEEECCCCCEEEEEe
Q 000080 2223 RAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLP--AANVPPPY---------ALASISALQFDHYGHRFASAA 2290 (2389)
Q Consensus 2223 rsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~--gh~~p~~G---------H~~~V~sVaFSPDG~~LASgS 2290 (2389)
+.|+|+|+|. ++++-+.++.|++||+.++........-+ ..+.-..| ....-..|+|+|||+.+++-+
T Consensus 743 ~GIavspdG~~LYVADs~n~~Irv~D~~tg~~~~~~gg~~~~~~~l~~fG~~dG~g~~~~l~~P~Gvavd~dG~LYVADs 822 (1057)
T PLN02919 743 SGISLSPDLKELYIADSESSSIRALDLKTGGSRLLAGGDPTFSDNLFKFGDHDGVGSEVLLQHPLGVLCAKDGQIYVADS 822 (1057)
T ss_pred cEEEEeCCCCEEEEEECCCCeEEEEECCCCcEEEEEecccccCcccccccCCCCchhhhhccCCceeeEeCCCcEEEEEC
Confidence 6679999998 67788889999999998775321110000 00000000 111236899999999999999
Q ss_pred CCCcEEEeeCCCCCccCcccceeeee--------------cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2291 LDGTVCTWQLEVGGRSNVRPMESCLC--------------FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2291 ~DgTVkLWDl~tggrs~~k~l~tl~g--------------Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
.+++|++||.+++. +.++.+ +-.....|++++ +|+++++- +.+++|++||+
T Consensus 823 ~N~rIrviD~~tg~------v~tiaG~G~~G~~dG~~~~a~l~~P~GIavd~-dG~lyVaD---t~Nn~Irvid~ 887 (1057)
T PLN02919 823 YNHKIKKLDPATKR------VTTLAGTGKAGFKDGKALKAQLSEPAGLALGE-NGRLFVAD---TNNSLIRYLDL 887 (1057)
T ss_pred CCCEEEEEECCCCe------EEEEeccCCcCCCCCcccccccCCceEEEEeC-CCCEEEEE---CCCCEEEEEEC
Confidence 99999999998752 122222 223567899999 99988874 68899999997
No 258
>PRK04043 tolB translocation protein TolB; Provisional
Probab=97.26 E-value=0.019 Score=72.81 Aligned_cols=200 Identities=7% Similarity=-0.022 Sum_probs=104.0
Q ss_pred cceeecCCCCCCeEEEEecC----CcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEEe--
Q 000080 42 STIDWLPDFAGYSWVAYGAS----SLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAAA-- 115 (2389)
Q Consensus 42 ~ai~wlpD~~G~~~vAYasg----~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaAS-- 115 (2389)
-...|+|| |...++|.+- ..|.+..+.. + +.. ++.+..+ .+...+|||| +..||..
T Consensus 191 ~~p~wSpD--G~~~i~y~s~~~~~~~Iyv~dl~t---g-~~~------~lt~~~g---~~~~~~~SPD---G~~la~~~~ 252 (419)
T PRK04043 191 IFPKWANK--EQTAFYYTSYGERKPTLYKYNLYT---G-KKE------KIASSQG---MLVVSDVSKD---GSKLLLTMA 252 (419)
T ss_pred EeEEECCC--CCcEEEEEEccCCCCEEEEEECCC---C-cEE------EEecCCC---cEEeeEECCC---CCEEEEEEc
Confidence 36899999 6434666422 3355555322 3 222 3333222 4677899998 6677743
Q ss_pred cCCeEEEEeeCCCCCCCCccceeeEEec-ccceEEEEeecCCCCeEEEEecc---eEEe--eccCCcEEEEEEeeccccc
Q 000080 116 SENCIFVFAHDSASSKGSFCWSQNAILV-QGTKVEAIEWTGSGDGIVAGGME---TVLW--KKKNTLWEIAWKFKENYPQ 189 (2389)
Q Consensus 116 yDntIRVw~~d~~~~kgd~~W~~~~tL~-hssTV~sIAWSpdG~rLaSggdD---V~IW--~~~~s~Wecvwt~~~~~~~ 189 (2389)
.++.-.||--+. ..+ .+. .++ +......-.|+|||++|+-.++. .+|| +..++..+.+.. .+. .
T Consensus 253 ~~g~~~Iy~~dl--~~g--~~~---~LT~~~~~d~~p~~SPDG~~I~F~Sdr~g~~~Iy~~dl~~g~~~rlt~-~g~--~ 322 (419)
T PRK04043 253 PKGQPDIYLYDT--NTK--TLT---QITNYPGIDVNGNFVEDDKRIVFVSDRLGYPNIFMKKLNSGSVEQVVF-HGK--N 322 (419)
T ss_pred cCCCcEEEEEEC--CCC--cEE---EcccCCCccCccEECCCCCEEEEEECCCCCceEEEEECCCCCeEeCcc-CCC--c
Confidence 234445554431 112 121 233 22223356899999999977763 3444 445566654431 111 1
Q ss_pred eEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccCc
Q 000080 190 NLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRH 268 (2389)
Q Consensus 190 ~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~n 268 (2389)
..+|||||. +|-.+....-. ......-+++..-++.. . .....+ ......+|+| ||+.
T Consensus 323 ---~~~~SPDG~~Ia~~~~~~~~~---~~~~~~~I~v~d~~~g~-~-~~LT~~-~~~~~p~~SP--------DG~~---- 381 (419)
T PRK04043 323 ---NSSVSTYKNYIVYSSRETNNE---FGKNTFNLYLISTNSDY-I-RRLTAN-GVNQFPRFSS--------DGGS---- 381 (419)
T ss_pred ---CceECCCCCEEEEEEcCCCcc---cCCCCcEEEEEECCCCC-e-EECCCC-CCcCCeEECC--------CCCE----
Confidence 238999999 77666531100 00001123443222221 1 211122 2334689999 7666
Q ss_pred eEEeeecCCeEEEEEeecCCcc
Q 000080 269 VLLTCCLDGTVRLWCEMDSGKT 290 (2389)
Q Consensus 269 ILAScSdDgTVRLW~e~d~Gk~ 290 (2389)
|+.+....+.-.||...-.|..
T Consensus 382 I~f~~~~~~~~~L~~~~l~g~~ 403 (419)
T PRK04043 382 IMFIKYLGNQSALGIIRLNYNK 403 (419)
T ss_pred EEEEEccCCcEEEEEEecCCCe
Confidence 4455545677788888866654
No 259
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=97.25 E-value=0.0099 Score=72.94 Aligned_cols=153 Identities=12% Similarity=0.199 Sum_probs=95.9
Q ss_pred eEEEEEEcCCCCeEEEEe-CCCcEEEeecCCCc--ee--eEecccCCCCCCCCCCCCCEEEEEECCCCCEE-EEEeCCCc
Q 000080 2221 STRAFSSHPLRPFFLVGS-SNTHIYLWEFGKDK--AT--ATYGVLPAANVPPPYALASISALQFDHYGHRF-ASAALDGT 2294 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS-~DgTIRLWDl~tGk--~l--~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~L-ASgS~DgT 2294 (2389)
+...+.|+|||++++... ....|+++++..+. .. ..+. ++ +| ..=+.++|+|||+++ +..-.+++
T Consensus 145 h~H~v~~~pdg~~v~v~dlG~D~v~~~~~~~~~~~l~~~~~~~-~~------~G--~GPRh~~f~pdg~~~Yv~~e~s~~ 215 (345)
T PF10282_consen 145 HPHQVVFSPDGRFVYVPDLGADRVYVYDIDDDTGKLTPVDSIK-VP------PG--SGPRHLAFSPDGKYAYVVNELSNT 215 (345)
T ss_dssp CEEEEEE-TTSSEEEEEETTTTEEEEEEE-TTS-TEEEEEEEE-CS------TT--SSEEEEEE-TTSSEEEEEETTTTE
T ss_pred cceeEEECCCCCEEEEEecCCCEEEEEEEeCCCceEEEeeccc-cc------cC--CCCcEEEEcCCcCEEEEecCCCCc
Confidence 347889999999766642 33479999997665 32 2232 12 12 446999999999866 66677899
Q ss_pred EEEeeCCCCCccCcccceeeee----c--CCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCc--eEEEEeec
Q 000080 2295 VCTWQLEVGGRSNVRPMESCLC----F--SSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSS--RASITCHE 2366 (2389)
Q Consensus 2295 VkLWDl~tggrs~~k~l~tl~g----H--s~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~--v~sL~GH~ 2366 (2389)
|.++++....- ..+.+.+... . .....+++++| ||++|..+- -.+++|-++++...+++. ++.+...-
T Consensus 216 v~v~~~~~~~g-~~~~~~~~~~~~~~~~~~~~~~~i~isp-dg~~lyvsn--r~~~sI~vf~~d~~~g~l~~~~~~~~~G 291 (345)
T PF10282_consen 216 VSVFDYDPSDG-SLTEIQTISTLPEGFTGENAPAEIAISP-DGRFLYVSN--RGSNSISVFDLDPATGTLTLVQTVPTGG 291 (345)
T ss_dssp EEEEEEETTTT-EEEEEEEEESCETTSCSSSSEEEEEE-T-TSSEEEEEE--CTTTEEEEEEECTTTTTEEEEEEEEESS
T ss_pred EEEEeecccCC-ceeEEEEeeeccccccccCCceeEEEec-CCCEEEEEe--ccCCEEEEEEEecCCCceEEEEEEeCCC
Confidence 99999982110 1122222211 1 12578899999 999877653 357799999985444443 34444433
Q ss_pred CcEEEEeecccchhhhcccc
Q 000080 2367 GLYDLFLPLKLLNFALSKCR 2386 (2389)
Q Consensus 2367 ~~V~svA~~~~~~~~~s~~~ 2386 (2389)
..-+.++++|+|+|.+--|+
T Consensus 292 ~~Pr~~~~s~~g~~l~Va~~ 311 (345)
T PF10282_consen 292 KFPRHFAFSPDGRYLYVANQ 311 (345)
T ss_dssp SSEEEEEE-TTSSEEEEEET
T ss_pred CCccEEEEeCCCCEEEEEec
Confidence 44689999999999886553
No 260
>KOG4190 consensus Uncharacterized conserved protein [Function unknown]
Probab=97.22 E-value=0.00068 Score=84.45 Aligned_cols=156 Identities=17% Similarity=0.185 Sum_probs=100.3
Q ss_pred ccccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecC-------CCceeeEecccCCCCCCCCCCCCCEE
Q 000080 2203 TQDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFG-------KDKATATYGVLPAANVPPPYALASIS 2275 (2389)
Q Consensus 2203 ~~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~-------tGk~l~Tl~vl~gh~~p~~GH~~~V~ 2275 (2389)
++.++..|+.+ .+.| |+++-=.+.+-++|+|.|+|||||.++ +..|.-||+ .|...|.
T Consensus 724 ~~irL~nf~GH---~~~i--Rai~AidNENSFiSASkDKTVKLWSik~EgD~~~tsaCQfTY~----------aHkk~i~ 788 (1034)
T KOG4190|consen 724 DHIRLCNFTGH---QEKI--RAIAAIDNENSFISASKDKTVKLWSIKPEGDEIGTSACQFTYQ----------AHKKPIH 788 (1034)
T ss_pred ceeeeecccCc---HHHh--HHHHhcccccceeeccCCceEEEEEeccccCccccceeeeEhh----------hccCccc
Confidence 35566666433 2222 666666677789999999999999876 223566664 3678899
Q ss_pred EEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeee--cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCC
Q 000080 2276 ALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLC--FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLA 2353 (2389)
Q Consensus 2276 sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~g--Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~ 2353 (2389)
++-|=.|-+.+|| .||.|.|||.=.| +++..... -.+.+..|--.++-.+.|..|| ++...|||+.|...
T Consensus 789 ~igfL~~lr~i~S--cD~giHlWDPFig-----r~Laq~~dapk~~a~~~ikcl~nv~~~iliAg-csaeSTVKl~DaRs 860 (1034)
T KOG4190|consen 789 DIGFLADLRSIAS--CDGGIHLWDPFIG-----RLLAQMEDAPKEGAGGNIKCLENVDRHILIAG-CSAESTVKLFDARS 860 (1034)
T ss_pred ceeeeeccceeee--ccCcceeeccccc-----chhHhhhcCcccCCCceeEecccCcchheeee-ccchhhheeeeccc
Confidence 9999999888775 5788999998765 22221111 1122333334443134555666 46889999999742
Q ss_pred CCCCceEEE---EeecCcEEEEeecccchhh
Q 000080 2354 PPTSSRASI---TCHEGLYDLFLPLKLLNFA 2381 (2389)
Q Consensus 2354 ~tg~~v~sL---~GH~~~V~svA~~~~~~~~ 2381 (2389)
-.-.|.... .+-.+-++++|.-++|||.
T Consensus 861 ce~~~E~kVcna~~Pna~~R~iaVa~~GN~l 891 (1034)
T KOG4190|consen 861 CEWTCELKVCNAPGPNALTRAIAVADKGNKL 891 (1034)
T ss_pred ccceeeEEeccCCCCchheeEEEeccCcchh
Confidence 222222222 3344568899999999993
No 261
>PLN02919 haloacid dehalogenase-like hydrolase family protein
Probab=97.20 E-value=0.0067 Score=84.52 Aligned_cols=149 Identities=10% Similarity=0.114 Sum_probs=95.2
Q ss_pred EEEEEcC-CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC------CCCCCCCCEEEEEECCCCC-EEEEEeCCCc
Q 000080 2223 RAFSSHP-LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV------PPPYALASISALQFDHYGH-RFASAALDGT 2294 (2389)
Q Consensus 2223 rsVAFsP-dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~------p~~GH~~~V~sVaFSPDG~-~LASgS~DgT 2294 (2389)
+.|+|+| +|.++++.+.++.|++||..+|... ++.+ .+... +........+.|+|+|||+ .+++-+.+++
T Consensus 686 ~gVa~dp~~g~LyVad~~~~~I~v~d~~~g~v~-~~~G-~G~~~~~~g~~~~~~~~~~P~GIavspdG~~LYVADs~n~~ 763 (1057)
T PLN02919 686 WDVCFEPVNEKVYIAMAGQHQIWEYNISDGVTR-VFSG-DGYERNLNGSSGTSTSFAQPSGISLSPDLKELYIADSESSS 763 (1057)
T ss_pred eEEEEecCCCeEEEEECCCCeEEEEECCCCeEE-EEec-CCccccCCCCccccccccCccEEEEeCCCCEEEEEECCCCe
Confidence 5679999 6778899999999999999877643 3321 01000 0001123457799999998 6667777899
Q ss_pred EEEeeCCCCCccCcccce-----------eee--------ecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCC
Q 000080 2295 VCTWQLEVGGRSNVRPME-----------SCL--------CFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPP 2355 (2389)
Q Consensus 2295 VkLWDl~tggrs~~k~l~-----------tl~--------gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~t 2355 (2389)
|+.||+++++. ..+. .+- ..-..-..++|++ +|.++++- +.+++|++||. .
T Consensus 764 Irv~D~~tg~~---~~~~gg~~~~~~~l~~fG~~dG~g~~~~l~~P~Gvavd~-dG~LYVAD---s~N~rIrviD~--~- 833 (1057)
T PLN02919 764 IRALDLKTGGS---RLLAGGDPTFSDNLFKFGDHDGVGSEVLLQHPLGVLCAK-DGQIYVAD---SYNHKIKKLDP--A- 833 (1057)
T ss_pred EEEEECCCCcE---EEEEecccccCcccccccCCCCchhhhhccCCceeeEeC-CCcEEEEE---CCCCEEEEEEC--C-
Confidence 99999987531 1000 000 0011235799999 89988764 58899999996 2
Q ss_pred CCceEEEEe--------------ecCcEEEEeecccchhhhc
Q 000080 2356 TSSRASITC--------------HEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2356 g~~v~sL~G--------------H~~~V~svA~~~~~~~~~s 2383 (2389)
+..+.++.| +-+....++.+++|+..++
T Consensus 834 tg~v~tiaG~G~~G~~dG~~~~a~l~~P~GIavd~dG~lyVa 875 (1057)
T PLN02919 834 TKRVTTLAGTGKAGFKDGKALKAQLSEPAGLALGENGRLFVA 875 (1057)
T ss_pred CCeEEEEeccCCcCCCCCcccccccCCceEEEEeCCCCEEEE
Confidence 233444433 2234567888899875544
No 262
>KOG4497 consensus Uncharacterized conserved protein WDR8, contains WD repeats [General function prediction only]
Probab=97.16 E-value=0.0013 Score=79.17 Aligned_cols=134 Identities=14% Similarity=0.077 Sum_probs=100.4
Q ss_pred EEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCC
Q 000080 2225 FSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEVG 2303 (2389)
Q Consensus 2225 VAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tg 2303 (2389)
.+|||+|+++|+.++- .+-+-|..+=+..+.|.- .+.|.-|-++.|. ..|-.++-|+.|++|++...
T Consensus 14 c~fSp~g~yiAs~~~y-rlviRd~~tlq~~qlf~c-----------ldki~yieW~ads~~ilC~~yk~~~vqvwsl~Qp 81 (447)
T KOG4497|consen 14 CSFSPCGNYIASLSRY-RLVIRDSETLQLHQLFLC-----------LDKIVYIEWKADSCHILCVAYKDPKVQVWSLVQP 81 (447)
T ss_pred eeECCCCCeeeeeeee-EEEEeccchhhHHHHHHH-----------HHHhhheeeeccceeeeeeeeccceEEEEEeecc
Confidence 3899999999998766 788888876665444421 2556777788887 56667788999999999864
Q ss_pred CccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhh
Q 000080 2304 GRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFA 2381 (2389)
Q Consensus 2304 grs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~ 2381 (2389)
.-.....+-+..+.++++|| ||+.|... ++-|-.|.+|.+. .+...-++.-...+..++++++|+|+
T Consensus 82 -----ew~ckIdeg~agls~~~WSP-dgrhiL~t--seF~lriTVWSL~---t~~~~~~~~pK~~~kg~~f~~dg~f~ 148 (447)
T KOG4497|consen 82 -----EWYCKIDEGQAGLSSISWSP-DGRHILLT--SEFDLRITVWSLN---TQKGYLLPHPKTNVKGYAFHPDGQFC 148 (447)
T ss_pred -----eeEEEeccCCCcceeeeECC-CcceEeee--ecceeEEEEEEec---cceeEEecccccCceeEEECCCCcee
Confidence 34556677778899999999 88666554 3688899999984 23334455445667899999999985
No 263
>PRK04043 tolB translocation protein TolB; Provisional
Probab=97.13 E-value=0.0057 Score=77.44 Aligned_cols=136 Identities=8% Similarity=0.058 Sum_probs=82.0
Q ss_pred EEEEEEcCCCCe-EEEEeC---CCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe-CC--Cc
Q 000080 2222 TRAFSSHPLRPF-FLVGSS---NTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA-LD--GT 2294 (2389)
Q Consensus 2222 VrsVAFsPdG~~-LASGS~---DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-~D--gT 2294 (2389)
+.+-.|+|||+. ++..+. +..|+++|+.+|+..+... . .+.+...+|||||+++|-.. .+ ..
T Consensus 190 ~~~p~wSpDG~~~i~y~s~~~~~~~Iyv~dl~tg~~~~lt~-~----------~g~~~~~~~SPDG~~la~~~~~~g~~~ 258 (419)
T PRK04043 190 NIFPKWANKEQTAFYYTSYGERKPTLYKYNLYTGKKEKIAS-S----------QGMLVVSDVSKDGSKLLLTMAPKGQPD 258 (419)
T ss_pred eEeEEECCCCCcEEEEEEccCCCCEEEEEECCCCcEEEEec-C----------CCcEEeeEECCCCCEEEEEEccCCCcE
Confidence 356799999984 654443 4679999998887644322 1 13356788999998777543 34 45
Q ss_pred EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCC--eEEEeeCCCCCCCceEEEEeecCcEEEE
Q 000080 2295 VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGI--NVVVWDTLAPPTSSRASITCHEGLYDLF 2372 (2389)
Q Consensus 2295 VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~--TVrLWD~l~~tg~~v~sL~GH~~~V~sv 2372 (2389)
|.++|+.++. ...+..+........|+| ||+.|+-.. ..++ .|.+.|+ .+++. +.+... +. ...
T Consensus 259 Iy~~dl~~g~------~~~LT~~~~~d~~p~~SP-DG~~I~F~S--dr~g~~~Iy~~dl--~~g~~-~rlt~~-g~-~~~ 324 (419)
T PRK04043 259 IYLYDTNTKT------LTQITNYPGIDVNGNFVE-DDKRIVFVS--DRLGYPNIFMKKL--NSGSV-EQVVFH-GK-NNS 324 (419)
T ss_pred EEEEECCCCc------EEEcccCCCccCccEECC-CCCEEEEEE--CCCCCceEEEEEC--CCCCe-EeCccC-CC-cCc
Confidence 6666887652 223333333334567999 999888753 2334 4555554 34443 333211 11 224
Q ss_pred eecccchhhh
Q 000080 2373 LPLKLLNFAL 2382 (2389)
Q Consensus 2373 A~~~~~~~~~ 2382 (2389)
+.+|+|++++
T Consensus 325 ~~SPDG~~Ia 334 (419)
T PRK04043 325 SVSTYKNYIV 334 (419)
T ss_pred eECCCCCEEE
Confidence 7899999764
No 264
>KOG1912 consensus WD40 repeat protein [General function prediction only]
Probab=97.12 E-value=0.002 Score=83.54 Aligned_cols=143 Identities=27% Similarity=0.489 Sum_probs=95.9
Q ss_pred ccccccCCCCCC-CcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCC
Q 000080 29 RSEFIPTAPTRS-TSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETP 107 (2389)
Q Consensus 29 ~~~~ip~ap~~~-~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~ 107 (2389)
-++|+|.+|.++ ++|++|+|. | .||||+++.|++.. + ...+++ |.||.|.- .|+.|+|.|. |
T Consensus 5 s~~tlpG~l~~sN~~A~Dw~~~--G--LiAygshslV~VVD--s--~s~q~i------qsie~h~s--~V~~VrWap~-~ 67 (1062)
T KOG1912|consen 5 SDHTLPGPLSRSNRNAADWSPS--G--LIAYGSHSLVSVVD--S--RSLQLI------QSIELHQS--AVTSVRWAPA-P 67 (1062)
T ss_pred ccccCCCCCCcccccccccCcc--c--eEEEecCceEEEEe--h--hhhhhh------hccccCcc--ceeEEEeccC-C
Confidence 367888888775 789999997 7 69999999999998 3 344667 99999975 8999999995 4
Q ss_pred CCC---------cEEEecC--CeEEEEeeCCCCCCCCccceeeEEecccceEEEEeecC---CC-CeEE--EEecceEEe
Q 000080 108 SIG---------QLAAASE--NCIFVFAHDSASSKGSFCWSQNAILVQGTKVEAIEWTG---SG-DGIV--AGGMETVLW 170 (2389)
Q Consensus 108 ~~G---------eIaASyD--ntIRVw~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSp---dG-~rLa--SggdDV~IW 170 (2389)
... -++|++| +.|-+|...-+ ....|.+ .+...|-++.|=+ ++ +.|+ .++..+.+|
T Consensus 68 ~p~~llS~~~~~lliAsaD~~GrIil~d~~~~---s~~~~l~----~~~~~~qdl~W~~~rd~Srd~LlaIh~ss~lvLw 140 (1062)
T KOG1912|consen 68 SPRDLLSPSSSQLLIASADISGRIILVDFVLA---SVINWLS----HSNDSVQDLCWVPARDDSRDVLLAIHGSSTLVLW 140 (1062)
T ss_pred CchhccCccccceeEEeccccCcEEEEEehhh---hhhhhhc----CCCcchhheeeeeccCcchheeEEecCCcEEEEE
Confidence 332 3557776 88888876411 1122332 2455666766643 44 3344 555569999
Q ss_pred eccCCcEEEEEEeeccccceEEEEeecC
Q 000080 171 KKKNTLWEIAWKFKENYPQNLVSATWSI 198 (2389)
Q Consensus 171 ~~~~s~Wecvwt~~~~~~~~ivsvaWSp 198 (2389)
...+ .+..|+. .+.+..+.|++.-|
T Consensus 141 ntdt--G~k~Wk~-~ys~~iLs~f~~DP 165 (1062)
T KOG1912|consen 141 NTDT--GEKFWKY-DYSHEILSCFRVDP 165 (1062)
T ss_pred EccC--Cceeecc-ccCCcceeeeeeCC
Confidence 7544 3444542 35566666776666
No 265
>KOG1240 consensus Protein kinase containing WD40 repeats [Signal transduction mechanisms]
Probab=97.05 E-value=0.0094 Score=80.76 Aligned_cols=165 Identities=12% Similarity=0.083 Sum_probs=110.9
Q ss_pred ccccccceeeccccccccccccccCCCC-----------cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCC--Ccee-
Q 000080 2189 PGYAGIGASALGWETQDDFEDYVDPPAT-----------VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGK--DKAT- 2254 (2389)
Q Consensus 2189 ~g~~~~~Asg~~~d~~~~~~~~~d~~at-----------v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~t--Gk~l- 2254 (2389)
++.+..-++| +.|.+.++|+..+.+.. .++-++..+.+-++|..+|.|+.||.|++-+++. ++..
T Consensus 1058 ~~~~s~Fvsg-S~DGtVKvW~~~k~~~~~~s~rS~ltys~~~sr~~~vt~~~~~~~~Av~t~DG~v~~~~id~~~~~~~~ 1136 (1431)
T KOG1240|consen 1058 SEHTSLFVSG-SDDGTVKVWNLRKLEGEGGSARSELTYSPEGSRVEKVTMCGNGDQFAVSTKDGSVRVLRIDHYNVSKRV 1136 (1431)
T ss_pred CCCCceEEEe-cCCceEEEeeehhhhcCcceeeeeEEEeccCCceEEEEeccCCCeEEEEcCCCeEEEEEccccccccce
Confidence 3444567888 88888999988644443 1234678899999999999999999999999876 2111
Q ss_pred ----eEe-----------cccCCCC-C---------------------------CCCCCCCCEEEEEECCCCCEEEEEeC
Q 000080 2255 ----ATY-----------GVLPAAN-V---------------------------PPPYALASISALQFDHYGHRFASAAL 2291 (2389)
Q Consensus 2255 ----~Tl-----------~vl~gh~-~---------------------------p~~GH~~~V~sVaFSPDG~~LASgS~ 2291 (2389)
+.. .....|. . -++-| +.|++++.+|-|++++.|..
T Consensus 1137 ~~~~ri~n~~~~g~vv~m~a~~~~~~S~~lvy~T~~~~iv~~D~r~~~~~w~lk~~~~h-G~vTSi~idp~~~WlviGts 1215 (1431)
T KOG1240|consen 1137 ATQVRIPNLKKDGVVVSMHAFTAIVQSHVLVYATDLSRIVSWDTRMRHDAWRLKNQLRH-GLVTSIVIDPWCNWLVIGTS 1215 (1431)
T ss_pred eeeeecccccCCCceEEeecccccccceeEEEEEeccceEEecchhhhhHHhhhcCccc-cceeEEEecCCceEEEEecC
Confidence 000 0000000 0 04445 78999999999999999999
Q ss_pred CCcEEEeeCCCCCccCcccceeee-ecCCCeeEEEEecC--CCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080 2292 DGTVCTWQLEVGGRSNVRPMESCL-CFSSHAMDVSYITS--SGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus 2292 DgTVkLWDl~tggrs~~k~l~tl~-gHs~~V~sVAFSP~--DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
-|.+-+||++=+ .++.++. +|...++-|...|- ....++++|. +..+-|-+|++. +|.|.+.|-
T Consensus 1216 ~G~l~lWDLRF~-----~~i~sw~~P~~~~i~~v~~~~~~~~~S~~vs~~~-~~~nevs~wn~~--~g~~~~vl~ 1282 (1431)
T KOG1240|consen 1216 RGQLVLWDLRFR-----VPILSWEHPARAPIRHVWLCPTYPQESVSVSAGS-SSNNEVSTWNME--TGLRQTVLW 1282 (1431)
T ss_pred CceEEEEEeecC-----ceeecccCcccCCcceEEeeccCCCCceEEEecc-cCCCceeeeecc--cCcceEEEE
Confidence 999999999864 3444432 23345555555542 3367777763 367789999984 556655554
No 266
>KOG0280 consensus Uncharacterized conserved protein [Amino acid transport and metabolism]
Probab=96.90 E-value=0.0094 Score=71.48 Aligned_cols=137 Identities=12% Similarity=-0.009 Sum_probs=96.5
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCcee--eEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEee
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKAT--ATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l--~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWD 2299 (2389)
-++.|++.|.-++++-.+|.+.+=+...+... ++++ + |.-..+..+|+-.. +.+-+|++|+.+.-||
T Consensus 125 lslD~~~~~~~i~vs~s~G~~~~v~~t~~~le~vq~wk---~-------He~E~Wta~f~~~~pnlvytGgDD~~l~~~D 194 (339)
T KOG0280|consen 125 LSLDISTSGTKIFVSDSRGSISGVYETEMVLEKVQTWK---V-------HEFEAWTAKFSDKEPNLVYTGGDDGSLSCWD 194 (339)
T ss_pred eEEEeeccCceEEEEcCCCcEEEEecceeeeeeccccc---c-------cceeeeeeecccCCCceEEecCCCceEEEEE
Confidence 46789999999999999999985444334322 2443 3 56778999998554 7999999999999999
Q ss_pred CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
++..+. .....-.-|...|.++-=+|+.+..|||| |-|-+|++||+.. =++.+..-. -.++||-+--+|-
T Consensus 195 ~R~p~~---~i~~n~kvH~~GV~SI~ss~~~~~~I~TG---sYDe~i~~~DtRn-m~kPl~~~~-v~GGVWRi~~~p~ 264 (339)
T KOG0280|consen 195 IRIPKT---FIWHNSKVHTSGVVSIYSSPPKPTYIATG---SYDECIRVLDTRN-MGKPLFKAK-VGGGVWRIKHHPE 264 (339)
T ss_pred ecCCcc---eeeecceeeecceEEEecCCCCCceEEEe---ccccceeeeehhc-ccCccccCc-cccceEEEEecch
Confidence 996421 22233566899999999999899999996 6899999999841 122221110 1166666655553
No 267
>KOG2695 consensus WD40 repeat protein [General function prediction only]
Probab=96.84 E-value=0.0016 Score=78.85 Aligned_cols=134 Identities=11% Similarity=0.097 Sum_probs=94.5
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCC-----ceeeEecccCCCCCCCCCCCCCEEEEEECC-CCCEEEEEeCCCcEE
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKD-----KATATYGVLPAANVPPPYALASISALQFDH-YGHRFASAALDGTVC 2296 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tG-----k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSP-DG~~LASgS~DgTVk 2296 (2389)
-++.|+..++++..|-.+|.|-..|++.+ .+.+.+ +|...|++++.=. ++++|.+.+.+|+|+
T Consensus 256 fAlQf~~s~nLv~~GcRngeI~~iDLR~rnqG~~~~a~rl-----------yh~Ssvtslq~Lq~s~q~LmaS~M~gkik 324 (425)
T KOG2695|consen 256 FALQFAGSDNLVFNGCRNGEIFVIDLRCRNQGNGWCAQRL-----------YHDSSVTSLQILQFSQQKLMASDMTGKIK 324 (425)
T ss_pred HHHHhcccCCeeEecccCCcEEEEEeeecccCCCcceEEE-----------EcCcchhhhhhhccccceEeeccCcCcee
Confidence 66789999999999999999999998743 455544 4778999998865 788999999999999
Q ss_pred EeeCCCCCccCcccceeeeecCCCeeE--EEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE----eecCcEE
Q 000080 2297 TWQLEVGGRSNVRPMESCLCFSSHAMD--VSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT----CHEGLYD 2370 (2389)
Q Consensus 2297 LWDl~tggrs~~k~l~tl~gHs~~V~s--VAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~----GH~~~V~ 2370 (2389)
|||++.-. .-+-+++++||...-.- +-..+ ....|+++| +|--.|||.+. ++..+.++. .-+..++
T Consensus 325 LyD~R~~K--~~~~V~qYeGHvN~~a~l~~~v~~-eeg~I~s~G---dDcytRiWsl~--~ghLl~tipf~~s~~e~d~~ 396 (425)
T KOG2695|consen 325 LYDLRATK--CKKSVMQYEGHVNLSAYLPAHVKE-EEGSIFSVG---DDCYTRIWSLD--SGHLLCTIPFPYSASEVDIP 396 (425)
T ss_pred Eeeehhhh--cccceeeeeccccccccccccccc-ccceEEEcc---CeeEEEEEecc--cCceeeccCCCCcccccccc
Confidence 99998642 11237888877643221 12223 334566665 99999999983 455555443 2334555
Q ss_pred EEeec
Q 000080 2371 LFLPL 2375 (2389)
Q Consensus 2371 svA~~ 2375 (2389)
++|+.
T Consensus 397 sv~~~ 401 (425)
T KOG2695|consen 397 SVAFD 401 (425)
T ss_pred ceehh
Confidence 66654
No 268
>KOG1354 consensus Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=96.74 E-value=0.0022 Score=77.64 Aligned_cols=140 Identities=19% Similarity=0.279 Sum_probs=92.6
Q ss_pred cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCC-CceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCc
Q 000080 2217 VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGK-DKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGT 2294 (2389)
Q Consensus 2217 v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~t-Gk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgT 2294 (2389)
.+...|.+|+++.|+..++| ++|=.|.||+++- .++..... +..++|--. +--|++-.|+|.- +.|+=.|.-|+
T Consensus 162 aHtyhiNSIS~NsD~Et~lS-ADdLRINLWnlei~d~sFnIVD-IKP~nmEeL--teVITsaEFhp~~cn~f~YSSSKGt 237 (433)
T KOG1354|consen 162 AHTYHINSISVNSDKETFLS-ADDLRINLWNLEIIDQSFNIVD-IKPANMEEL--TEVITSAEFHPHHCNVFVYSSSKGT 237 (433)
T ss_pred cceeEeeeeeecCccceEee-ccceeeeeccccccCCceeEEE-ccccCHHHH--HHHHhhhccCHhHccEEEEecCCCc
Confidence 34456789999999999998 5899999999873 33322221 122332100 1347888999985 89999999999
Q ss_pred EEEeeCCCCCc--cCccccee---------eeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080 2295 VCTWQLEVGGR--SNVRPMES---------CLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus 2295 VkLWDl~tggr--s~~k~l~t---------l~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
|||-|++.... ...+.+.. +.+--..|.+|-|++ +|++|+|- +=-||+|||+.. ..+.+.+.+
T Consensus 238 IrLcDmR~~aLCd~hsKlfEepedp~~rsffseiIsSISDvKFs~-sGryilsR----Dyltvk~wD~nm-e~~pv~t~~ 311 (433)
T KOG1354|consen 238 IRLCDMRQSALCDAHSKLFEEPEDPSSRSFFSEIISSISDVKFSH-SGRYILSR----DYLTVKLWDLNM-EAKPVETYP 311 (433)
T ss_pred EEEeechhhhhhcchhhhhccccCCcchhhHHHHhhhhhceEEcc-CCcEEEEe----ccceeEEEeccc-cCCcceEEe
Confidence 99999985310 00011100 111225688999999 99999983 348999999842 344566666
Q ss_pred eec
Q 000080 2364 CHE 2366 (2389)
Q Consensus 2364 GH~ 2366 (2389)
-|.
T Consensus 312 vh~ 314 (433)
T KOG1354|consen 312 VHE 314 (433)
T ss_pred ehH
Confidence 554
No 269
>KOG0280 consensus Uncharacterized conserved protein [Amino acid transport and metabolism]
Probab=96.72 E-value=0.006 Score=73.04 Aligned_cols=96 Identities=7% Similarity=0.104 Sum_probs=72.7
Q ss_pred eeEEEEEEcCCCC-eEEEEeCCCcEEEeecC-CCceeeEecccCCCCCCCCCCCCCEEEEEEC-CCCCEEEEEeCCCcEE
Q 000080 2220 ISTRAFSSHPLRP-FFLVGSSNTHIYLWEFG-KDKATATYGVLPAANVPPPYALASISALQFD-HYGHRFASAALDGTVC 2296 (2389)
Q Consensus 2220 i~VrsVAFsPdG~-~LASGS~DgTIRLWDl~-tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFS-PDG~~LASgS~DgTVk 2296 (2389)
.+.|..+|+...+ ++.|||+|+.++.||++ .++.+-+- . .-|...|.+|.-| |++..+|+|+-|..|+
T Consensus 166 ~E~Wta~f~~~~pnlvytGgDD~~l~~~D~R~p~~~i~~n------~---kvH~~GV~SI~ss~~~~~~I~TGsYDe~i~ 236 (339)
T KOG0280|consen 166 FEAWTAKFSDKEPNLVYTGGDDGSLSCWDIRIPKTFIWHN------S---KVHTSGVVSIYSSPPKPTYIATGSYDECIR 236 (339)
T ss_pred eeeeeeecccCCCceEEecCCCceEEEEEecCCcceeeec------c---eeeecceEEEecCCCCCceEEEecccccee
Confidence 3558888888766 78899999999999998 44444321 0 1266789999998 5689999999999999
Q ss_pred EeeCCCCCccCcccceeeeecCCCeeEEEEecC
Q 000080 2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITS 2329 (2389)
Q Consensus 2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~ 2329 (2389)
+||.+.-+ +|+..-. -.+.|+.+..+|.
T Consensus 237 ~~DtRnm~----kPl~~~~-v~GGVWRi~~~p~ 264 (339)
T KOG0280|consen 237 VLDTRNMG----KPLFKAK-VGGGVWRIKHHPE 264 (339)
T ss_pred eeehhccc----CccccCc-cccceEEEEecch
Confidence 99999654 4554321 3378999998884
No 270
>KOG2079 consensus Vacuolar assembly/sorting protein VPS8 [Intracellular trafficking, secretion, and vesicular transport]
Probab=96.57 E-value=0.0065 Score=81.54 Aligned_cols=107 Identities=16% Similarity=0.286 Sum_probs=74.1
Q ss_pred cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEE
Q 000080 2217 VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVC 2296 (2389)
Q Consensus 2217 v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVk 2296 (2389)
.+.+.++.++.---+-++|.|++-|+|-+.|+. |..-.-.+ +.+ -...|++|+|+.||++++.|=.||.|.
T Consensus 85 ~e~~~~~v~s~a~~~~~ivi~Ts~ghvl~~d~~-~nL~~~~~---ne~-----v~~~Vtsvafn~dg~~l~~G~~~G~V~ 155 (1206)
T KOG2079|consen 85 LEDIAAGVISSAIVVVPIVIGTSHGHVLLSDMT-GNLGPLHQ---NER-----VQGPVTSVAFNQDGSLLLAGLGDGHVT 155 (1206)
T ss_pred ccCCCcceeeeeeeeeeEEEEcCchhhhhhhhh-cccchhhc---CCc-----cCCcceeeEecCCCceeccccCCCcEE
Confidence 334555556666667789999999999999984 43211111 111 126799999999999999999999999
Q ss_pred EeeCCCCCccCcccceeeeecCCCeeEEEEec--CCCCEEEEe
Q 000080 2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYIT--SSGSVIAAA 2337 (2389)
Q Consensus 2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP--~DGslLASA 2337 (2389)
+||+.++ ++++.+.-|..++..|-++- .++..+.|+
T Consensus 156 v~D~~~~-----k~l~~i~e~~ap~t~vi~v~~t~~nS~llt~ 193 (1206)
T KOG2079|consen 156 VWDMHRA-----KILKVITEHGAPVTGVIFVGRTSQNSKLLTS 193 (1206)
T ss_pred EEEccCC-----cceeeeeecCCccceEEEEEEeCCCcEEEEc
Confidence 9999986 46666666766666554441 134455553
No 271
>KOG4714 consensus Nucleoporin [Nuclear structure]
Probab=96.56 E-value=0.0041 Score=73.46 Aligned_cols=73 Identities=16% Similarity=0.235 Sum_probs=64.8
Q ss_pred CCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEee
Q 000080 2272 ASISALQFDHYG-HRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWD 2350 (2389)
Q Consensus 2272 ~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD 2350 (2389)
..|++++-.|.. +.++.|++||.|-|||.+... .|...+..|...++.|-|+|.++..|.|+ |+||.+.-||
T Consensus 180 ~~v~~l~~hp~qq~~v~cgt~dg~~~l~d~rn~~----~p~S~l~ahk~~i~eV~FHpk~p~~Lft~---sedGslw~wd 252 (319)
T KOG4714|consen 180 DAVTALCSHPAQQHLVCCGTDDGIVGLWDARNVA----MPVSLLKAHKAEIWEVHFHPKNPEHLFTC---SEDGSLWHWD 252 (319)
T ss_pred ccchhhhCCcccccEEEEecCCCeEEEEEccccc----chHHHHHHhhhhhhheeccCCCchheeEe---cCCCcEEEEc
Confidence 559999999885 788899999999999999763 57778889999999999999999999986 7999999999
Q ss_pred C
Q 000080 2351 T 2351 (2389)
Q Consensus 2351 ~ 2351 (2389)
.
T Consensus 253 a 253 (319)
T KOG4714|consen 253 A 253 (319)
T ss_pred C
Confidence 5
No 272
>KOG2314 consensus Translation initiation factor 3, subunit b (eIF-3b) [Translation, ribosomal structure and biogenesis]
Probab=96.47 E-value=0.016 Score=73.63 Aligned_cols=168 Identities=15% Similarity=0.233 Sum_probs=101.0
Q ss_pred eecCC--CCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEEec-CCeEE
Q 000080 45 DWLPD--FAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAAAS-ENCIF 121 (2389)
Q Consensus 45 ~wlpD--~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaASy-DntIR 121 (2389)
.|+-| ...|--++|..+..+.+-| +-..+ +|.. ++-... =.-+.|.||| .|..++++ --.|-
T Consensus 170 ~WL~d~~~RDQf~v~~d~~~~~svfw--N~~~n-----~p~~---ie~Ren-WTetyv~wSP----~GTYL~t~Hk~GI~ 234 (698)
T KOG2314|consen 170 SWLMDDKCRDQFVVQDDVKTTVSVFW--NSKFN-----EPSL---IEEREN-WTETYVRWSP----KGTYLVTFHKQGIA 234 (698)
T ss_pred HHHhCccccceEEEEecCcceeEEEc--cccCC-----chhh---hhhhhc-ceeeeEEecC----CceEEEEEecccee
Confidence 46744 3444346777777677777 42222 1111 111111 2367899999 58889887 46899
Q ss_pred EEeeCCCCCCCCccceeeEEecccceEEEEeecCCCCeEEEEecc-------------eEEeeccCCcEEEEEEe--ecc
Q 000080 122 VFAHDSASSKGSFCWSQNAILVQGTKVEAIEWTGSGDGIVAGGME-------------TVLWKKKNTLWEIAWKF--KEN 186 (2389)
Q Consensus 122 Vw~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSpdG~rLaSggdD-------------V~IW~~~~s~Wecvwt~--~~~ 186 (2389)
+|.-. .|...+-+.|. -|.-|.|||+-+||+|=|-. +.||+-.++.-+..+.. .+.
T Consensus 235 lWGG~--------~f~r~~RF~Hp-~Vq~idfSP~EkYLVT~s~~p~~~~~~d~e~~~l~IWDI~tG~lkrsF~~~~~~~ 305 (698)
T KOG2314|consen 235 LWGGE--------SFDRIQRFYHP-GVQFIDFSPNEKYLVTYSPEPIIVEEDDNEGQQLIIWDIATGLLKRSFPVIKSPY 305 (698)
T ss_pred eecCc--------cHHHHHhccCC-CceeeecCCccceEEEecCCccccCcccCCCceEEEEEccccchhcceeccCCCc
Confidence 99755 25555555666 68899999999999987652 55777665554444333 233
Q ss_pred ccceEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEecc
Q 000080 187 YPQNLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRP 252 (2389)
Q Consensus 187 ~~~~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~P 252 (2389)
..-+++ .||.|++ +|--.++.- -|. ...+....-...-....|..++|+|
T Consensus 306 ~~WP~f--rWS~DdKy~Arm~~~si-------------sIy-Etpsf~lld~Kslki~gIr~FswsP 356 (698)
T KOG2314|consen 306 LKWPIF--RWSHDDKYFARMTGNSI-------------SIY-ETPSFMLLDKKSLKISGIRDFSWSP 356 (698)
T ss_pred cccceE--EeccCCceeEEeccceE-------------EEE-ecCceeeecccccCCccccCcccCC
Confidence 334565 9999999 886555321 111 1111111112244667899999999
No 273
>smart00320 WD40 WD40 repeats. Note that these repeats are permuted with respect to the structural repeats (blades) of the beta propeller domain.
Probab=96.42 E-value=0.0076 Score=46.29 Aligned_cols=30 Identities=30% Similarity=0.546 Sum_probs=28.1
Q ss_pred CCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2270 ALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2270 H~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
|...|++++|+|+++.+++++.|++|++||
T Consensus 11 ~~~~i~~~~~~~~~~~~~~~~~d~~~~~~~ 40 (40)
T smart00320 11 HTGPVTSVAFSPDGKYLASASDDGTIKLWD 40 (40)
T ss_pred cCCceeEEEECCCCCEEEEecCCCeEEEcC
Confidence 567899999999999999999999999996
No 274
>PF15492 Nbas_N: Neuroblastoma-amplified sequence, N terminal
Probab=96.42 E-value=0.046 Score=65.78 Aligned_cols=122 Identities=12% Similarity=0.175 Sum_probs=80.5
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCC------------------------------------
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVP------------------------------------ 2266 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p------------------------------------ 2266 (2389)
|.++||||+.+||.+...|+|+++|+- |..+.+.. |++..+
T Consensus 47 Rkl~WSpD~tlLa~a~S~G~i~vfdl~-g~~lf~I~--p~~~~~~d~~~Aiagl~Fl~~~~s~~ws~ELlvi~Y~G~L~S 123 (282)
T PF15492_consen 47 RKLAWSPDCTLLAYAESTGTIRVFDLM-GSELFVIP--PAMSFPGDLSDAIAGLIFLEYKKSAQWSYELLVINYRGQLRS 123 (282)
T ss_pred eEEEECCCCcEEEEEcCCCeEEEEecc-cceeEEcC--cccccCCccccceeeeEeeccccccccceeEEEEeccceeee
Confidence 888999999999999999999999984 43332221 111000
Q ss_pred -------------------CCCCCCCEEEEEECCCCCEEEEEeCC-----------CcEEEeeCCCCC----------c-
Q 000080 2267 -------------------PPYALASISALQFDHYGHRFASAALD-----------GTVCTWQLEVGG----------R- 2305 (2389)
Q Consensus 2267 -------------------~~GH~~~V~sVaFSPDG~~LASgS~D-----------gTVkLWDl~tgg----------r- 2305 (2389)
..++...|.++.+.|.-+.|..|+.. .-+.-|.+-.+. .
T Consensus 124 y~vs~gt~q~y~e~hsfsf~~~yp~Gi~~~vy~p~h~LLlVgG~~~~~~~~s~a~~~GLtaWRiL~~~Pyyk~v~~~~~~ 203 (282)
T PF15492_consen 124 YLVSVGTNQGYQENHSFSFSSHYPHGINSAVYHPKHRLLLVGGCEQNQDGMSKASSCGLTAWRILSDSPYYKQVTSSEDD 203 (282)
T ss_pred EEEEcccCCcceeeEEEEecccCCCceeEEEEcCCCCEEEEeccCCCCCccccccccCceEEEEcCCCCcEEEccccCcc
Confidence 12234569999999998888777642 135567553320 0
Q ss_pred -------cCccccee-----e-eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2306 -------SNVRPMES-----C-LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2306 -------s~~k~l~t-----l-~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
.+...+.+ . ......|..+..|| ||++||+. ..+|.|.||++
T Consensus 204 ~~~~~~~~~~~~~~~~~~fs~~~~~~d~i~kmSlSP-dg~~La~i---h~sG~lsLW~i 258 (282)
T PF15492_consen 204 ITASSKRRGLLRIPSFKFFSRQGQEQDGIFKMSLSP-DGSLLACI---HFSGSLSLWEI 258 (282)
T ss_pred ccccccccceeeccceeeeeccccCCCceEEEEECC-CCCEEEEE---EcCCeEEEEec
Confidence 00000111 1 12357889999999 99999997 47899999998
No 275
>KOG0309 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=96.39 E-value=0.0071 Score=78.27 Aligned_cols=133 Identities=21% Similarity=0.343 Sum_probs=99.2
Q ss_pred EEEEEcCC--CC-eEEEEeCCCcEEEeecCCCc--eeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEE
Q 000080 2223 RAFSSHPL--RP-FFLVGSSNTHIYLWEFGKDK--ATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVC 2296 (2389)
Q Consensus 2223 rsVAFsPd--G~-~LASGS~DgTIRLWDl~tGk--~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVk 2296 (2389)
-.+.|+|. -+ ++++-|. ..--+|++.... .+.-+ + .||+..|+.+-|+|+- ..+|+++.|-.|.
T Consensus 71 ad~qws~h~a~~~wiVsts~-qkaiiwnlA~ss~~aIef~--l-------hghsraitd~n~~~q~pdVlatcsvdt~vh 140 (1081)
T KOG0309|consen 71 ADVQWSPHPAKPYWIVSTSN-QKAIIWNLAKSSSNAIEFV--L-------HGHSRAITDINFNPQHPDVLATCSVDTYVH 140 (1081)
T ss_pred cceecccCCCCceeEEecCc-chhhhhhhhcCCccceEEE--E-------ecCccceeccccCCCCCcceeeccccccce
Confidence 33455554 33 4665544 445589987443 34322 2 3688999999999986 7999999999999
Q ss_pred EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080 2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus 2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
.||+++.. .|+....--......|+++-.++..||+ +.++.|++||+. ..+..+.++.+|...|+.+++
T Consensus 141 ~wd~rSp~----~p~ys~~~w~s~asqVkwnyk~p~vlas----shg~~i~vwd~r-~gs~pl~s~K~~vs~vn~~~f 209 (1081)
T KOG0309|consen 141 AWDMRSPH----RPFYSTSSWRSAASQVKWNYKDPNVLAS----SHGNDIFVWDLR-KGSTPLCSLKGHVSSVNSIDF 209 (1081)
T ss_pred eeeccCCC----cceeeeecccccCceeeecccCcchhhh----ccCCceEEEecc-CCCcceEEecccceeeehHHH
Confidence 99999863 6777766555667889999879999997 588999999984 233458999999988887765
No 276
>COG2706 3-carboxymuconate cyclase [Carbohydrate transport and metabolism]
Probab=96.19 E-value=0.17 Score=62.50 Aligned_cols=151 Identities=9% Similarity=0.067 Sum_probs=99.8
Q ss_pred EEEEEcCCCCeEEEEe-CCCcEEEeecCC-CceeeEecccCCCCCCCCCC----CCCEEEEEECCCCCEEEEEeCC-CcE
Q 000080 2223 RAFSSHPLRPFFLVGS-SNTHIYLWEFGK-DKATATYGVLPAANVPPPYA----LASISALQFDHYGHRFASAALD-GTV 2295 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS-~DgTIRLWDl~t-Gk~l~Tl~vl~gh~~p~~GH----~~~V~sVaFSPDG~~LASgS~D-gTV 2295 (2389)
-.|+++++|++|++++ .-|.|.+.-++. |......+. ..|.-+ ..| ..-+....|+|||+++++.+.. ..|
T Consensus 92 ~yvsvd~~g~~vf~AnY~~g~v~v~p~~~dG~l~~~v~~-~~h~g~-~p~~rQ~~~h~H~a~~tP~~~~l~v~DLG~Dri 169 (346)
T COG2706 92 CYVSVDEDGRFVFVANYHSGSVSVYPLQADGSLQPVVQV-VKHTGS-GPHERQESPHVHSANFTPDGRYLVVPDLGTDRI 169 (346)
T ss_pred eEEEECCCCCEEEEEEccCceEEEEEcccCCccccceee-eecCCC-CCCccccCCccceeeeCCCCCEEEEeecCCceE
Confidence 4569999999999988 568899999865 543322111 122211 112 0128999999999999998853 458
Q ss_pred EEeeCCCCCccCcccceee-eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEee---------
Q 000080 2296 CTWQLEVGGRSNVRPMESC-LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCH--------- 2365 (2389)
Q Consensus 2296 kLWDl~tggrs~~k~l~tl-~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH--------- 2365 (2389)
.+++++.|. +.+.... ..-...-+-++|+| +|++.-.. +--++||-+|++... ...+..+|-|
T Consensus 170 ~~y~~~dg~---L~~~~~~~v~~G~GPRHi~FHp-n~k~aY~v--~EL~stV~v~~y~~~-~g~~~~lQ~i~tlP~dF~g 242 (346)
T COG2706 170 FLYDLDDGK---LTPADPAEVKPGAGPRHIVFHP-NGKYAYLV--NELNSTVDVLEYNPA-VGKFEELQTIDTLPEDFTG 242 (346)
T ss_pred EEEEcccCc---cccccccccCCCCCcceEEEcC-CCcEEEEE--eccCCEEEEEEEcCC-CceEEEeeeeccCccccCC
Confidence 999999763 2232221 12334557799999 99976664 268999999998532 2334444443
Q ss_pred cCcEEEEeecccchhhh
Q 000080 2366 EGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus 2366 ~~~V~svA~~~~~~~~~ 2382 (2389)
..+...|..+++|||.-
T Consensus 243 ~~~~aaIhis~dGrFLY 259 (346)
T COG2706 243 TNWAAAIHISPDGRFLY 259 (346)
T ss_pred CCceeEEEECCCCCEEE
Confidence 35677899999999853
No 277
>KOG1409 consensus Uncharacterized conserved protein, contains WD40 repeats and FYVE domains [Function unknown]
Probab=96.15 E-value=0.014 Score=71.04 Aligned_cols=74 Identities=20% Similarity=0.461 Sum_probs=62.7
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.+++++|.|..++|.||+.|..|-+||++-.+-+ .+. +.||.+.|+++..-+--++|.|++.||-|-+||.
T Consensus 199 ~~~~l~Wd~~~~~LfSg~~d~~vi~wdigg~~g~-~~e--------l~gh~~kV~~l~~~~~t~~l~S~~edg~i~~w~m 269 (404)
T KOG1409|consen 199 EVTCLKWDPGQRLLFSGASDHSVIMWDIGGRKGT-AYE--------LQGHNDKVQALSYAQHTRQLISCGEDGGIVVWNM 269 (404)
T ss_pred ceEEEEEcCCCcEEEeccccCceEEEeccCCcce-eee--------eccchhhhhhhhhhhhheeeeeccCCCeEEEEec
Confidence 5689999999999999999999999999744433 222 1367799999999999999999999999999998
Q ss_pred CCC
Q 000080 2301 EVG 2303 (2389)
Q Consensus 2301 ~tg 2303 (2389)
+..
T Consensus 270 n~~ 272 (404)
T KOG1409|consen 270 NVK 272 (404)
T ss_pred cce
Confidence 764
No 278
>PF11768 DUF3312: Protein of unknown function (DUF3312); InterPro: IPR024511 This is a eukaryotic family of uncharacterised proteins that contain WD40 repeats.
Probab=96.01 E-value=0.021 Score=73.62 Aligned_cols=69 Identities=9% Similarity=0.128 Sum_probs=58.2
Q ss_pred CCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2272 ASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2272 ~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
..|.+.++||+.++|+.|..||+|.|||..++ +.++..+.-....++|+| +|.+++.| ++-|.+++||+
T Consensus 260 s~v~~ca~sp~E~kLvlGC~DgSiiLyD~~~~-------~t~~~ka~~~P~~iaWHp-~gai~~V~---s~qGelQ~FD~ 328 (545)
T PF11768_consen 260 SQVICCARSPSEDKLVLGCEDGSIILYDTTRG-------VTLLAKAEFIPTLIAWHP-DGAIFVVG---SEQGELQCFDM 328 (545)
T ss_pred CcceEEecCcccceEEEEecCCeEEEEEcCCC-------eeeeeeecccceEEEEcC-CCcEEEEE---cCCceEEEEEe
Confidence 66999999999999999999999999999864 223334455667899999 99999986 57799999998
No 279
>PF04762 IKI3: IKI3 family; InterPro: IPR006849 Members of this family are components of the elongator multi-subunit component of a novel RNA polymerase II holoenzyme for transcriptional elongation [].
Probab=95.96 E-value=0.46 Score=66.16 Aligned_cols=164 Identities=23% Similarity=0.413 Sum_probs=99.2
Q ss_pred eeEEEEcCCCCCCCcEEEec-----CCeEEEEeeCCCCCCCCccceeeEEe---cccceEEEEeecCCCCeEEEEec-ce
Q 000080 97 VTSISWSPETPSIGQLAAAS-----ENCIFVFAHDSASSKGSFCWSQNAIL---VQGTKVEAIEWTGSGDGIVAGGM-ET 167 (2389)
Q Consensus 97 Vk~VaWSPd~~~~GeIaASy-----DntIRVw~~d~~~~kgd~~W~~~~tL---~hssTV~sIAWSpdG~rLaSggd-DV 167 (2389)
=-+++|.| +|.++|+. ...|.+|++..-. -|+| +| .....|..|+||+||+-||..-. .|
T Consensus 259 e~~l~WrP----sG~lIA~~q~~~~~~~VvFfErNGLr-hgeF------~l~~~~~~~~v~~l~Wn~ds~iLAv~~~~~v 327 (928)
T PF04762_consen 259 EGALSWRP----SGNLIASSQRLPDRHDVVFFERNGLR-HGEF------TLRFDPEEEKVIELAWNSDSEILAVWLEDRV 327 (928)
T ss_pred cCCccCCC----CCCEEEEEEEcCCCcEEEEEecCCcE-eeeE------ecCCCCCCceeeEEEECCCCCEEEEEecCCc
Confidence 34789999 57777653 2567777776211 1111 12 24668999999999999995544 59
Q ss_pred EEeeccCCcEEEEEEeeccccceEEEEeecCCCc----eEeeec-ccc----cccC---C-CCCCCceeEEEeeCCCccc
Q 000080 168 VLWKKKNTLWEIAWKFKENYPQNLVSATWSIEGP----SATAAS-MSQ----LDLL---G-PKEAGKCVFICCSDGKSEY 234 (2389)
Q Consensus 168 ~IW~~~~s~Wecvwt~~~~~~~~ivsvaWSpdG~----fATag~-dik----f~~~---~-~~~~~kpV~V~~~dg~~~~ 234 (2389)
++|-.+|.-|=.=-.+.-.....+..+.|+|.-. +.|.++ ... +... + ..++...|.|. ||..-.
T Consensus 328 qLWt~~NYHWYLKqei~~~~~~~~~~~~Wdpe~p~~L~v~t~~g~~~~~~~~~~v~~s~~~~~~D~g~vaVI--DG~~ll 405 (928)
T PF04762_consen 328 QLWTRSNYHWYLKQEIRFSSSESVNFVKWDPEKPLRLHVLTSNGQYEIYDFAWDVSRSPGSSPNDNGTVAVI--DGNKLL 405 (928)
T ss_pred eEEEeeCCEEEEEEEEEccCCCCCCceEECCCCCCEEEEEecCCcEEEEEEEEEEEecCCCCccCceEEEEE--eCCeEE
Confidence 9999999998432222211222233379999744 445423 211 1111 1 12223445555 444311
Q ss_pred e-------------eecccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeec
Q 000080 235 I-------------KLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMD 286 (2389)
Q Consensus 235 ~-------------~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d 286 (2389)
. ..+..-+.+|+.|+++|+ +.. +|.-..||++-+|+...
T Consensus 406 lTpf~~a~VPPPMs~~~l~~~~~v~~vaf~~~--------~~~-----~avl~~d~~l~~~~~~~ 457 (928)
T PF04762_consen 406 LTPFRRAVVPPPMSSYELELPSPVNDVAFSPS--------NSR-----FAVLTSDGSLSIYEWDL 457 (928)
T ss_pred EecccccCCCchHhceEEcCCCCcEEEEEeCC--------CCe-----EEEEECCCCEEEEEecC
Confidence 1 123566789999999993 222 88888999999999654
No 280
>COG2706 3-carboxymuconate cyclase [Carbohydrate transport and metabolism]
Probab=95.91 E-value=0.18 Score=62.33 Aligned_cols=128 Identities=15% Similarity=0.194 Sum_probs=84.1
Q ss_pred eEEEEEEcCCCCeEEE-EeCCCcEEEeecCCC--c--eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe-CCCc
Q 000080 2221 STRAFSSHPLRPFFLV-GSSNTHIYLWEFGKD--K--ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA-LDGT 2294 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LAS-GS~DgTIRLWDl~tG--k--~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-~DgT 2294 (2389)
.-|-|+|||+|++... .=-+++|-+|+.... + ++++...+|+.- .| ..+..+|..+|||++|-+.- ....
T Consensus 192 GPRHi~FHpn~k~aY~v~EL~stV~v~~y~~~~g~~~~lQ~i~tlP~dF---~g-~~~~aaIhis~dGrFLYasNRg~ds 267 (346)
T COG2706 192 GPRHIVFHPNGKYAYLVNELNSTVDVLEYNPAVGKFEELQTIDTLPEDF---TG-TNWAAAIHISPDGRFLYASNRGHDS 267 (346)
T ss_pred CcceEEEcCCCcEEEEEeccCCEEEEEEEcCCCceEEEeeeeccCcccc---CC-CCceeEEEECCCCCEEEEecCCCCe
Confidence 4488899999997443 458999999999863 2 344443344431 23 26789999999999876544 4456
Q ss_pred EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCC
Q 000080 2295 VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPT 2356 (2389)
Q Consensus 2295 VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg 2356 (2389)
|-+.-+...+. .+..+....-|...-+++.|+| +|++|+.++- ++.+|.++.....+|
T Consensus 268 I~~f~V~~~~g-~L~~~~~~~teg~~PR~F~i~~-~g~~Liaa~q--~sd~i~vf~~d~~TG 325 (346)
T COG2706 268 IAVFSVDPDGG-KLELVGITPTEGQFPRDFNINP-SGRFLIAANQ--KSDNITVFERDKETG 325 (346)
T ss_pred EEEEEEcCCCC-EEEEEEEeccCCcCCccceeCC-CCCEEEEEcc--CCCcEEEEEEcCCCc
Confidence 66666654320 1222222233444468999999 9999998863 556799999854443
No 281
>COG5170 CDC55 Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=95.89 E-value=0.011 Score=70.99 Aligned_cols=140 Identities=15% Similarity=0.198 Sum_probs=93.1
Q ss_pred cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc-eeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCc
Q 000080 2217 VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK-ATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGT 2294 (2389)
Q Consensus 2217 v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk-~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgT 2294 (2389)
.+...+.+|+|+.|.+.++| ++|=.|.||++.-.. +..... +..|+|.-. .--|++-.|+|.- +.|.=.+..|+
T Consensus 170 aH~yhiNSiS~NsD~et~lS-aDdLrINLWnl~i~D~sFnIVD-iKP~nmeeL--teVItSaeFhp~~cn~fmYSsSkG~ 245 (460)
T COG5170 170 AHPYHINSISFNSDKETLLS-ADDLRINLWNLEIIDGSFNIVD-IKPHNMEEL--TEVITSAEFHPEMCNVFMYSSSKGE 245 (460)
T ss_pred cceeEeeeeeecCchheeee-ccceeeeeccccccCCceEEEe-ccCccHHHH--HHHHhhcccCHhHcceEEEecCCCc
Confidence 34456789999999999998 589999999987433 222111 233443210 1347888999985 67777888999
Q ss_pred EEEeeCCCCCc-cCcccce--e--------eeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080 2295 VCTWQLEVGGR-SNVRPME--S--------CLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus 2295 VkLWDl~tggr-s~~k~l~--t--------l~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
|+|-|++.... -+.+.+. + +.+-...|.++.|++ +|++|++- +=-||+|||+.. ...++.++.
T Consensus 246 Ikl~DlRq~alcdn~~klfe~~~D~v~~~ff~eivsSISD~kFs~-ngryIlsR----dyltvkiwDvnm-~k~pikTi~ 319 (460)
T COG5170 246 IKLNDLRQSALCDNSKKLFELTIDGVDVDFFEEIVSSISDFKFSD-NGRYILSR----DYLTVKIWDVNM-AKNPIKTIP 319 (460)
T ss_pred EEehhhhhhhhccCchhhhhhccCcccchhHHHHhhhhcceEEcC-CCcEEEEe----ccceEEEEeccc-ccCCceeec
Confidence 99999985310 0001111 1 112235678999999 99999984 557999999853 346677765
Q ss_pred eec
Q 000080 2364 CHE 2366 (2389)
Q Consensus 2364 GH~ 2366 (2389)
-|.
T Consensus 320 ~h~ 322 (460)
T COG5170 320 MHC 322 (460)
T ss_pred hHH
Confidence 454
No 282
>KOG1354 consensus Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=95.87 E-value=0.021 Score=69.64 Aligned_cols=136 Identities=18% Similarity=0.248 Sum_probs=90.9
Q ss_pred EEEEEEcCCCC-eEEEEeCCCcEEEeecCCCc-ee---eEecccCCCCCC---CCCCCCCEEEEEECCCCCEEEEEeCCC
Q 000080 2222 TRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDK-AT---ATYGVLPAANVP---PPYALASISALQFDHYGHRFASAALDG 2293 (2389)
Q Consensus 2222 VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk-~l---~Tl~vl~gh~~p---~~GH~~~V~sVaFSPDG~~LASgS~Dg 2293 (2389)
|.+.-|||..- .++-.|.-|+|||-|+++.. |- +.|. .|-.... ..+-...|..|+||+.|++++|-+. -
T Consensus 216 ITsaEFhp~~cn~f~YSSSKGtIrLcDmR~~aLCd~hsKlfE-epedp~~rsffseiIsSISDvKFs~sGryilsRDy-l 293 (433)
T KOG1354|consen 216 ITSAEFHPHHCNVFVYSSSKGTIRLCDMRQSALCDAHSKLFE-EPEDPSSRSFFSEIISSISDVKFSHSGRYILSRDY-L 293 (433)
T ss_pred HhhhccCHhHccEEEEecCCCcEEEeechhhhhhcchhhhhc-cccCCcchhhHHHHhhhhhceEEccCCcEEEEecc-c
Confidence 46778999754 67778999999999997443 11 1221 1111000 1112356899999999999998765 8
Q ss_pred cEEEeeCCCCCccCcccceeeeecCC------------Cee---EEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCc
Q 000080 2294 TVCTWQLEVGGRSNVRPMESCLCFSS------------HAM---DVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSS 2358 (2389)
Q Consensus 2294 TVkLWDl~tggrs~~k~l~tl~gHs~------------~V~---sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~ 2358 (2389)
||+|||++... +|+.+.+-|.. .|. .++|+. ++..++|| |-.+..|+.+.. ...+.
T Consensus 294 tvk~wD~nme~----~pv~t~~vh~~lr~kLc~lYEnD~IfdKFec~~sg-~~~~v~TG---sy~n~frvf~~~-~gsk~ 364 (433)
T KOG1354|consen 294 TVKLWDLNMEA----KPVETYPVHEYLRSKLCSLYENDAIFDKFECSWSG-NDSYVMTG---SYNNVFRVFNLA-RGSKE 364 (433)
T ss_pred eeEEEeccccC----CcceEEeehHhHHHHHHHHhhccchhheeEEEEcC-CcceEecc---cccceEEEecCC-CCcce
Confidence 99999998653 67777777652 333 588998 88999996 467899999952 22222
Q ss_pred eEEEEeecCc
Q 000080 2359 RASITCHEGL 2368 (2389)
Q Consensus 2359 v~sL~GH~~~ 2368 (2389)
-.++.+....
T Consensus 365 d~tl~asr~~ 374 (433)
T KOG1354|consen 365 DFTLEASRKN 374 (433)
T ss_pred eecccccccC
Confidence 3455544433
No 283
>KOG4190 consensus Uncharacterized conserved protein [Function unknown]
Probab=95.87 E-value=0.0057 Score=76.71 Aligned_cols=79 Identities=19% Similarity=0.247 Sum_probs=64.9
Q ss_pred CCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCcc--CcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCe
Q 000080 2268 PYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRS--NVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGIN 2345 (2389)
Q Consensus 2268 ~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs--~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~T 2345 (2389)
.||...|++++-=.+-+-|.|+|.|.|||||.++..+.. ...+-.+++.|...|.++.|-- |-+.+|+ -|+-
T Consensus 732 ~GH~~~iRai~AidNENSFiSASkDKTVKLWSik~EgD~~~tsaCQfTY~aHkk~i~~igfL~-~lr~i~S-----cD~g 805 (1034)
T KOG4190|consen 732 TGHQEKIRAIAAIDNENSFISASKDKTVKLWSIKPEGDEIGTSACQFTYQAHKKPIHDIGFLA-DLRSIAS-----CDGG 805 (1034)
T ss_pred cCcHHHhHHHHhcccccceeeccCCceEEEEEeccccCccccceeeeEhhhccCcccceeeee-ccceeee-----ccCc
Confidence 367889999987777889999999999999999775321 1136678899999999999998 7788886 4788
Q ss_pred EEEeeCC
Q 000080 2346 VVVWDTL 2352 (2389)
Q Consensus 2346 VrLWD~l 2352 (2389)
|.+||..
T Consensus 806 iHlWDPF 812 (1034)
T KOG4190|consen 806 IHLWDPF 812 (1034)
T ss_pred ceeeccc
Confidence 9999974
No 284
>KOG4532 consensus WD40-like repeat containing protein [General function prediction only]
Probab=95.56 E-value=0.18 Score=60.54 Aligned_cols=128 Identities=11% Similarity=0.033 Sum_probs=86.3
Q ss_pred EEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccce-
Q 000080 2234 FLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPME- 2312 (2389)
Q Consensus 2234 LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~- 2312 (2389)
+.-+|.|.|+|+.++.-+...... |. + .-.+.+.++||||+++++.++-..|-++-+...+. ....
T Consensus 131 ~~i~sndht~k~~~~~~~s~~~~~-----h~-~----~~~~ns~~~snd~~~~~~Vgds~~Vf~y~id~~se---y~~~~ 197 (344)
T KOG4532|consen 131 LNIASNDHTGKTMVVSGDSNKFAV-----HN-Q----NLTQNSLHYSNDPSWGSSVGDSRRVFRYAIDDESE---YIENI 197 (344)
T ss_pred eeeccCCcceeEEEEecCccccee-----ec-c----ccceeeeEEcCCCceEEEecCCCcceEEEeCCccc---eeeee
Confidence 444689999999999655432221 21 0 02288999999999999999999999998876431 2222
Q ss_pred eeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCC---CCCCceEEEEeecCcEEEEeecccc
Q 000080 2313 SCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLA---PPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus 2313 tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~---~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
....-+.+-....|+. .....|++ +.|+++.|||+.. +....-.+=..|.+.++.+-+++.|
T Consensus 198 ~~a~t~D~gF~~S~s~-~~~~FAv~---~Qdg~~~I~DVR~~~tpm~~~sstrp~hnGa~R~c~Fsl~g 262 (344)
T KOG4532|consen 198 YEAPTSDHGFYNSFSE-NDLQFAVV---FQDGTCAIYDVRNMATPMAEISSTRPHHNGAFRVCRFSLYG 262 (344)
T ss_pred EecccCCCceeeeecc-CcceEEEE---ecCCcEEEEEecccccchhhhcccCCCCCCceEEEEecCCC
Confidence 2333445566788998 56788886 6999999999841 1111111223488888888888654
No 285
>KOG2321 consensus WD40 repeat protein [General function prediction only]
Probab=95.53 E-value=0.09 Score=67.55 Aligned_cols=116 Identities=13% Similarity=0.203 Sum_probs=83.4
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
|.+++|--.--|..|+....|+=.++.+|+-+..|.. ..+.|++|..+|--..||.|+.||+|..||.++
T Consensus 137 RDm~y~~~scDly~~gsg~evYRlNLEqGrfL~P~~~----------~~~~lN~v~in~~hgLla~Gt~~g~VEfwDpR~ 206 (703)
T KOG2321|consen 137 RDMKYHKPSCDLYLVGSGSEVYRLNLEQGRFLNPFET----------DSGELNVVSINEEHGLLACGTEDGVVEFWDPRD 206 (703)
T ss_pred ccccccCCCccEEEeecCcceEEEEcccccccccccc----------ccccceeeeecCccceEEecccCceEEEecchh
Confidence 4445554333344555566799999999998877752 136799999999999999999999999999987
Q ss_pred CCcc-CcccceeeeecCCC-----eeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080 2303 GGRS-NVRPMESCLCFSSH-----AMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2303 ggrs-~~k~l~tl~gHs~~-----V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
..+. .+....+...|.+. |+++.|+- ||-.+|.| +.+|.|-|+|+.
T Consensus 207 ksrv~~l~~~~~v~s~pg~~~~~svTal~F~d-~gL~~aVG---ts~G~v~iyDLR 258 (703)
T KOG2321|consen 207 KSRVGTLDAASSVNSHPGGDAAPSVTALKFRD-DGLHVAVG---TSTGSVLIYDLR 258 (703)
T ss_pred hhhheeeecccccCCCccccccCcceEEEecC-CceeEEee---ccCCcEEEEEcc
Confidence 4210 01111222234444 99999997 89999874 678999999984
No 286
>COG4946 Uncharacterized protein related to the periplasmic component of the Tol biopolymer transport system [Function unknown]
Probab=95.47 E-value=0.24 Score=62.69 Aligned_cols=139 Identities=12% Similarity=0.043 Sum_probs=95.5
Q ss_pred eEEEEEEcCCCCeEEEEeCCC-cEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2221 STRAFSSHPLRPFFLVGSSNT-HIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~Dg-TIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
+||-..+.-++.-++-|-.|| .+-++|.++|+..+.-. ..+.|.+|+.+|||+.++.|-.-..+-+-|
T Consensus 361 ~VrY~r~~~~~e~~vigt~dgD~l~iyd~~~~e~kr~e~-----------~lg~I~av~vs~dGK~~vvaNdr~el~vid 429 (668)
T COG4946 361 GVRYRRIQVDPEGDVIGTNDGDKLGIYDKDGGEVKRIEK-----------DLGNIEAVKVSPDGKKVVVANDRFELWVID 429 (668)
T ss_pred ceEEEEEccCCcceEEeccCCceEEEEecCCceEEEeeC-----------CccceEEEEEcCCCcEEEEEcCceEEEEEE
Confidence 356677777777788899999 99999998877544321 236799999999999999988888777779
Q ss_pred CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCC--CCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSS--NGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS--~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
+.+| +++.+.. ...+-|.+++++| ++++||=| +-+ --+.|+|+|+. +++. .....-++-=.+=|+.|+
T Consensus 430 idng---nv~~idk--S~~~lItdf~~~~-nsr~iAYa-fP~gy~tq~Iklydm~--~~Ki-y~vTT~ta~DfsPaFD~d 499 (668)
T COG4946 430 IDNG---NVRLIDK--SEYGLITDFDWHP-NSRWIAYA-FPEGYYTQSIKLYDMD--GGKI-YDVTTPTAYDFSPAFDPD 499 (668)
T ss_pred ecCC---CeeEecc--cccceeEEEEEcC-CceeEEEe-cCcceeeeeEEEEecC--CCeE-EEecCCcccccCcccCCC
Confidence 9987 2233322 2457889999999 89999964 311 23579999983 3332 222212221234566666
Q ss_pred chh
Q 000080 2378 LNF 2380 (2389)
Q Consensus 2378 ~~~ 2380 (2389)
||.
T Consensus 500 ~ry 502 (668)
T COG4946 500 GRY 502 (668)
T ss_pred CcE
Confidence 664
No 287
>PF11768 DUF3312: Protein of unknown function (DUF3312); InterPro: IPR024511 This is a eukaryotic family of uncharacterised proteins that contain WD40 repeats.
Probab=95.30 E-value=0.049 Score=70.39 Aligned_cols=71 Identities=11% Similarity=0.217 Sum_probs=58.9
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.|.+.+++|+...|+.|..||+|.|||..++....+ + +. =..+.|+++|+|..|++|+.-|.+++||+
T Consensus 261 ~v~~ca~sp~E~kLvlGC~DgSiiLyD~~~~~t~~~-k---a~--------~~P~~iaWHp~gai~~V~s~qGelQ~FD~ 328 (545)
T PF11768_consen 261 QVICCARSPSEDKLVLGCEDGSIILYDTTRGVTLLA-K---AE--------FIPTLIAWHPDGAIFVVGSEQGELQCFDM 328 (545)
T ss_pred cceEEecCcccceEEEEecCCeEEEEEcCCCeeeee-e---ec--------ccceEEEEcCCCcEEEEEcCCceEEEEEe
Confidence 458899999999999999999999999877743322 1 11 22588999999999999999999999999
Q ss_pred CCC
Q 000080 2301 EVG 2303 (2389)
Q Consensus 2301 ~tg 2303 (2389)
.-.
T Consensus 329 ALs 331 (545)
T PF11768_consen 329 ALS 331 (545)
T ss_pred ecC
Confidence 764
No 288
>KOG1334 consensus WD40 repeat protein [General function prediction only]
Probab=95.26 E-value=0.026 Score=71.17 Aligned_cols=106 Identities=18% Similarity=0.193 Sum_probs=83.2
Q ss_pred CCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCC-CEEEEeecCCCCCeEE
Q 000080 2269 YALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSG-SVIAAAGHSSNGINVV 2347 (2389)
Q Consensus 2269 GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DG-slLASAG~sS~D~TVr 2347 (2389)
+|.+-|..|.|+..|..|+|||.|.+|-+||-..+. ..+.--.||...|...-|.|..| +.|++. +.||.||
T Consensus 140 ~H~GcVntV~FN~~Gd~l~SgSDD~~vv~WdW~~~~----~~l~f~SGH~~NvfQaKFiP~s~d~ti~~~---s~dgqvr 212 (559)
T KOG1334|consen 140 KHKGCVNTVHFNQRGDVLASGSDDLQVVVWDWVSGS----PKLSFESGHCNNVFQAKFIPFSGDRTIVTS---SRDGQVR 212 (559)
T ss_pred CCCCccceeeecccCceeeccCccceEEeehhhccC----cccccccccccchhhhhccCCCCCcCceec---cccCcee
Confidence 567899999999999999999999999999998762 22333467888787778988733 567764 6999999
Q ss_pred EeeCCCCCCCc--eEEEEeecCcEEEEeecccchhhh
Q 000080 2348 VWDTLAPPTSS--RASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus 2348 LWD~l~~tg~~--v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
+=.++ .++.+ ...+.-|.+.|.-+|.-|.-..-+
T Consensus 213 ~s~i~-~t~~~e~t~rl~~h~g~vhklav~p~sp~~f 248 (559)
T KOG1334|consen 213 VSEIL-ETGYVENTKRLAPHEGPVHKLAVEPDSPKPF 248 (559)
T ss_pred eeeec-cccceecceecccccCccceeeecCCCCCcc
Confidence 99985 45555 466788999999999887755443
No 289
>PF08450 SGL: SMP-30/Gluconolaconase/LRE-like region; InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=95.22 E-value=0.66 Score=54.10 Aligned_cols=141 Identities=15% Similarity=0.116 Sum_probs=92.1
Q ss_pred eeEEEEEEcCCCCeEEEEeCC--------CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEE-EEEe
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSN--------THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRF-ASAA 2290 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~D--------gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~L-ASgS 2290 (2389)
.....+++.|+|.+.++.+.. +.|..++.. ++....... ...-..|+|+|||+.| ++-+
T Consensus 86 ~~~ND~~vd~~G~ly~t~~~~~~~~~~~~g~v~~~~~~-~~~~~~~~~-----------~~~pNGi~~s~dg~~lyv~ds 153 (246)
T PF08450_consen 86 NRPNDVAVDPDGNLYVTDSGGGGASGIDPGSVYRIDPD-GKVTVVADG-----------LGFPNGIAFSPDGKTLYVADS 153 (246)
T ss_dssp EEEEEEEE-TTS-EEEEEECCBCTTCGGSEEEEEEETT-SEEEEEEEE-----------ESSEEEEEEETTSSEEEEEET
T ss_pred CCCceEEEcCCCCEEEEecCCCccccccccceEEECCC-CeEEEEecC-----------cccccceEECCcchheeeccc
Confidence 455788999999999987755 567888876 664443321 2446899999999866 5777
Q ss_pred CCCcEEEeeCCCCCc--cCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCc
Q 000080 2291 LDGTVCTWQLEVGGR--SNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGL 2368 (2389)
Q Consensus 2291 ~DgTVkLWDl~tggr--s~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~ 2368 (2389)
..+.|.-+++...+. ...+.+..+..-.+....+++.. +|++.++. ...+.|.+.|. .|+.+..+..-...
T Consensus 154 ~~~~i~~~~~~~~~~~~~~~~~~~~~~~~~g~pDG~~vD~-~G~l~va~---~~~~~I~~~~p---~G~~~~~i~~p~~~ 226 (246)
T PF08450_consen 154 FNGRIWRFDLDADGGELSNRRVFIDFPGGPGYPDGLAVDS-DGNLWVAD---WGGGRIVVFDP---DGKLLREIELPVPR 226 (246)
T ss_dssp TTTEEEEEEEETTTCCEEEEEEEEE-SSSSCEEEEEEEBT-TS-EEEEE---ETTTEEEEEET---TSCEEEEEE-SSSS
T ss_pred ccceeEEEeccccccceeeeeeEEEcCCCCcCCCcceEcC-CCCEEEEE---cCCCEEEEECC---CccEEEEEcCCCCC
Confidence 888888888864321 01122222222223466799999 99988763 25678999994 57878877766668
Q ss_pred EEEEeec-ccch
Q 000080 2369 YDLFLPL-KLLN 2379 (2389)
Q Consensus 2369 V~svA~~-~~~~ 2379 (2389)
++++++- ++++
T Consensus 227 ~t~~~fgg~~~~ 238 (246)
T PF08450_consen 227 PTNCAFGGPDGK 238 (246)
T ss_dssp EEEEEEESTTSS
T ss_pred EEEEEEECCCCC
Confidence 9999983 4433
No 290
>KOG4714 consensus Nucleoporin [Nuclear structure]
Probab=95.16 E-value=0.014 Score=69.07 Aligned_cols=73 Identities=19% Similarity=0.367 Sum_probs=60.4
Q ss_pred eEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-CCEEEEEeCCCcEEEe
Q 000080 2221 STRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-GHRFASAALDGTVCTW 2298 (2389)
Q Consensus 2221 ~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~DgTVkLW 2298 (2389)
.|.+++-||..+ ++++|++||.|.|||+++..-...+ +. .|...++.|-|.|. +..|.++|+||.+--|
T Consensus 181 ~v~~l~~hp~qq~~v~cgt~dg~~~l~d~rn~~~p~S~--l~-------ahk~~i~eV~FHpk~p~~Lft~sedGslw~w 251 (319)
T KOG4714|consen 181 AVTALCSHPAQQHLVCCGTDDGIVGLWDARNVAMPVSL--LK-------AHKAEIWEVHFHPKNPEHLFTCSEDGSLWHW 251 (319)
T ss_pred cchhhhCCcccccEEEEecCCCeEEEEEcccccchHHH--HH-------HhhhhhhheeccCCCchheeEecCCCcEEEE
Confidence 478999999866 6888999999999999888533333 22 35688999999986 6899999999999999
Q ss_pred eCCC
Q 000080 2299 QLEV 2302 (2389)
Q Consensus 2299 Dl~t 2302 (2389)
|-.+
T Consensus 252 das~ 255 (319)
T KOG4714|consen 252 DAST 255 (319)
T ss_pred cCCC
Confidence 9874
No 291
>KOG4532 consensus WD40-like repeat containing protein [General function prediction only]
Probab=95.05 E-value=0.16 Score=60.83 Aligned_cols=113 Identities=13% Similarity=0.123 Sum_probs=83.4
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc--eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK--ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk--~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
.+.+++++||+++.++-++-..|-++.+.+.. .++++. +. .++.=.++.||...-.||++..||++.+|
T Consensus 160 ~~ns~~~snd~~~~~~Vgds~~Vf~y~id~~sey~~~~~~---a~------t~D~gF~~S~s~~~~~FAv~~Qdg~~~I~ 230 (344)
T KOG4532|consen 160 TQNSLHYSNDPSWGSSVGDSRRVFRYAIDDESEYIENIYE---AP------TSDHGFYNSFSENDLQFAVVFQDGTCAIY 230 (344)
T ss_pred ceeeeEEcCCCceEEEecCCCcceEEEeCCccceeeeeEe---cc------cCCCceeeeeccCcceEEEEecCCcEEEE
Confidence 35788999999999999999999999987553 344332 11 13445789999999999999999999999
Q ss_pred eCCCCCccCcccc----eeeeecCCCeeEEEEecCCCC---EEEEeecCCCCCeEEEeeC
Q 000080 2299 QLEVGGRSNVRPM----ESCLCFSSHAMDVSYITSSGS---VIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2299 Dl~tggrs~~k~l----~tl~gHs~~V~sVAFSP~DGs---lLASAG~sS~D~TVrLWD~ 2351 (2389)
|++..+ .|. .+-.-|.+.++.+.|+| .|. ++.|-++ +-+.|-|+
T Consensus 231 DVR~~~----tpm~~~sstrp~hnGa~R~c~Fsl-~g~lDLLf~sEhf----s~~hv~D~ 281 (344)
T KOG4532|consen 231 DVRNMA----TPMAEISSTRPHHNGAFRVCRFSL-YGLLDLLFISEHF----SRVHVVDT 281 (344)
T ss_pred Eecccc----cchhhhcccCCCCCCceEEEEecC-CCcceEEEEecCc----ceEEEEEc
Confidence 998753 122 12234899999999997 443 4445432 45777887
No 292
>KOG2066 consensus Vacuolar assembly/sorting protein VPS41 [Intracellular trafficking, secretion, and vesicular transport]
Probab=95.05 E-value=0.14 Score=67.88 Aligned_cols=112 Identities=17% Similarity=0.178 Sum_probs=79.4
Q ss_pred cCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-----CCEEEEEeCCCcEEEeeCCC
Q 000080 2228 HPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-----GHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus 2228 sPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-----G~~LASgS~DgTVkLWDl~t 2302 (2389)
.-+|.++||+|.||+|.+--+.+++...++.- .-.+.+|+|+|| .++|++|+.-| +-|..=+-
T Consensus 80 ~~~Gey~asCS~DGkv~I~sl~~~~~~~~~df-----------~rpiksial~Pd~~~~~sk~fv~GG~ag-lvL~er~w 147 (846)
T KOG2066|consen 80 ILEGEYVASCSDDGKVVIGSLFTDDEITQYDF-----------KRPIKSIALHPDFSRQQSKQFVSGGMAG-LVLSERNW 147 (846)
T ss_pred ccCCceEEEecCCCcEEEeeccCCccceeEec-----------CCcceeEEeccchhhhhhhheeecCcce-EEEehhhh
Confidence 34699999999999999999999987665530 145899999999 57999999998 77764332
Q ss_pred CCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080 2303 GGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus 2303 ggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
-+ +-..+ .+..-.+.|.++.|.. ++||=| +|--||++|+ ++++.+..++
T Consensus 148 lg--nk~~v-~l~~~eG~I~~i~W~g---~lIAWa----nd~Gv~vyd~--~~~~~l~~i~ 196 (846)
T KOG2066|consen 148 LG--NKDSV-VLSEGEGPIHSIKWRG---NLIAWA----NDDGVKVYDT--PTRQRLTNIP 196 (846)
T ss_pred hc--Cccce-eeecCccceEEEEecC---cEEEEe----cCCCcEEEec--cccceeeccC
Confidence 22 11122 2333457899999985 899976 4455999998 3444444444
No 293
>smart00320 WD40 WD40 repeats. Note that these repeats are permuted with respect to the structural repeats (blades) of the beta propeller domain.
Probab=94.95 E-value=0.054 Score=41.52 Aligned_cols=38 Identities=18% Similarity=0.387 Sum_probs=32.3
Q ss_pred ccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEee
Q 000080 2309 RPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWD 2350 (2389)
Q Consensus 2309 k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD 2350 (2389)
++...+.+|...|.+++|.+ ++++++++ +.|++|++||
T Consensus 3 ~~~~~~~~~~~~i~~~~~~~-~~~~~~~~---~~d~~~~~~~ 40 (40)
T smart00320 3 ELLKTLKGHTGPVTSVAFSP-DGKYLASA---SDDGTIKLWD 40 (40)
T ss_pred EEEEEEEecCCceeEEEECC-CCCEEEEe---cCCCeEEEcC
Confidence 35667778999999999999 77888886 5899999997
No 294
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=94.41 E-value=0.86 Score=57.34 Aligned_cols=102 Identities=14% Similarity=0.034 Sum_probs=70.7
Q ss_pred CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC----------CCcEEEeeCCCCCccCccc
Q 000080 2241 THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL----------DGTVCTWQLEVGGRSNVRP 2310 (2389)
Q Consensus 2241 gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~----------DgTVkLWDl~tggrs~~k~ 2310 (2389)
++|.+-|..+++-+.++.+ | ..... + +||||+.|..+.. +.+|.+||+++. ++
T Consensus 27 ~~v~ViD~~~~~v~g~i~~--G-------~~P~~--~-~spDg~~lyva~~~~~R~~~G~~~d~V~v~D~~t~-----~~ 89 (352)
T TIGR02658 27 TQVYTIDGEAGRVLGMTDG--G-------FLPNP--V-VASDGSFFAHASTVYSRIARGKRTDYVEVIDPQTH-----LP 89 (352)
T ss_pred ceEEEEECCCCEEEEEEEc--c-------CCCce--e-ECCCCCEEEEEeccccccccCCCCCEEEEEECccC-----cE
Confidence 8999999999988877742 2 22222 4 9999988877766 899999999986 23
Q ss_pred ceeeee-------cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080 2311 MESCLC-------FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus 2311 l~tl~g-------Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
+..+.- ....-..++++| ||++|..+-. +.++.|-+.|+ ++++-+..+.
T Consensus 90 ~~~i~~p~~p~~~~~~~~~~~~ls~-dgk~l~V~n~-~p~~~V~VvD~--~~~kvv~ei~ 145 (352)
T TIGR02658 90 IADIELPEGPRFLVGTYPWMTSLTP-DNKTLLFYQF-SPSPAVGVVDL--EGKAFVRMMD 145 (352)
T ss_pred EeEEccCCCchhhccCccceEEECC-CCCEEEEecC-CCCCEEEEEEC--CCCcEEEEEe
Confidence 433321 122334799999 9998886532 23899999998 4555555544
No 295
>COG4946 Uncharacterized protein related to the periplasmic component of the Tol biopolymer transport system [Function unknown]
Probab=94.31 E-value=0.86 Score=58.03 Aligned_cols=103 Identities=12% Similarity=0.003 Sum_probs=80.3
Q ss_pred CCCCCCCEEEEEECCCCCEEEEEeCCC-cEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCe
Q 000080 2267 PPYALASISALQFDHYGHRFASAALDG-TVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGIN 2345 (2389)
Q Consensus 2267 ~~GH~~~V~sVaFSPDG~~LASgS~Dg-TVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~T 2345 (2389)
+.||...|+=.+|.-|++-++.|..|| .+-+.|.+++. +.....--+.|.+|..+| ||+.++.| +| .
T Consensus 355 qv~~~~~VrY~r~~~~~e~~vigt~dgD~l~iyd~~~~e------~kr~e~~lg~I~av~vs~-dGK~~vva----Nd-r 422 (668)
T COG4946 355 QVGKKGGVRYRRIQVDPEGDVIGTNDGDKLGIYDKDGGE------VKRIEKDLGNIEAVKVSP-DGKKVVVA----ND-R 422 (668)
T ss_pred EcCCCCceEEEEEccCCcceEEeccCCceEEEEecCCce------EEEeeCCccceEEEEEcC-CCcEEEEE----cC-c
Confidence 567788899999999999999999999 89999999862 344445557899999999 99988874 44 3
Q ss_pred EEEeeCCCCCCCceEEEEeecCcEEEEeecccchhh
Q 000080 2346 VVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFA 2381 (2389)
Q Consensus 2346 VrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~ 2381 (2389)
..||=+...+++....=+...+-|+.++.||.++|+
T Consensus 423 ~el~vididngnv~~idkS~~~lItdf~~~~nsr~i 458 (668)
T COG4946 423 FELWVIDIDNGNVRLIDKSEYGLITDFDWHPNSRWI 458 (668)
T ss_pred eEEEEEEecCCCeeEecccccceeEEEEEcCCceeE
Confidence 566654445666544446677889999999999986
No 296
>KOG1920 consensus IkappaB kinase complex, IKAP component [Transcription]
Probab=94.04 E-value=3.6 Score=57.61 Aligned_cols=92 Identities=17% Similarity=0.172 Sum_probs=61.3
Q ss_pred hHHH--HhhcchhHHHHHHHHhcCChhHHHHHHHHhcCChhhhhhhhhhh-ccCCChhhHhhHhhhcccc-ccccCChhH
Q 000080 1315 NAYV--LLGRHQLELAIAFFLLGGDAASAVTVCARNLGDVQLALVICRLV-EKHGGPLERNLVTKFILPS-SIERGDYWL 1390 (2389)
Q Consensus 1315 NAya--LLsK~Ry~~AAAFFLLAg~lkDAV~Vc~~~L~D~qLAi~IaRLy-Egd~gp~l~~lL~~~vLp~-a~~~gDrwL 1390 (2389)
+||| |..+++|+.||-+|..+|.++.|+. +.+--+|.+=|+.|++.. +|.+ .+. . +-+.+... ..++...=.
T Consensus 943 ~~ya~hL~~~~~~~~Aal~Ye~~GklekAl~-a~~~~~dWr~~l~~a~ql~~~~d-e~~-~-~a~~L~s~L~e~~kh~eA 1018 (1265)
T KOG1920|consen 943 EAYADHLREELMSDEAALMYERCGKLEKALK-AYKECGDWREALSLAAQLSEGKD-ELV-I-LAEELVSRLVEQRKHYEA 1018 (1265)
T ss_pred HHHHHHHHHhccccHHHHHHHHhccHHHHHH-HHHHhccHHHHHHHHHhhcCCHH-HHH-H-HHHHHHHHHHHcccchhH
Confidence 4554 8899999999999999999999996 566679999999988854 4432 111 1 11222221 122233345
Q ss_pred HHHHHHHhCChhHHHHHHhc
Q 000080 1391 TSLLEWELGNYSQSFLTMLG 1410 (2389)
Q Consensus 1391 ~S~a~W~L~~~~~Av~~Ll~ 1410 (2389)
+.++.=-+.++.+|+..|++
T Consensus 1019 a~il~e~~sd~~~av~ll~k 1038 (1265)
T KOG1920|consen 1019 AKILLEYLSDPEEAVALLCK 1038 (1265)
T ss_pred HHHHHHHhcCHHHHHHHHhh
Confidence 56666677888888877764
No 297
>KOG2041 consensus WD40 repeat protein [General function prediction only]
Probab=93.92 E-value=0.36 Score=63.22 Aligned_cols=102 Identities=17% Similarity=0.305 Sum_probs=67.4
Q ss_pred eEEEEecCCcEE-EEeCCC--Ccccccc---cccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEEe-cCCeEEEEeeC
Q 000080 54 SWVAYGASSLLV-ISHFPS--PLSQEEA---LIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAAA-SENCIFVFAHD 126 (2389)
Q Consensus 54 ~~vAYasg~~vV-I~~l~S--P~~~~e~---~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaAS-yDntIRVw~~d 126 (2389)
.+||+|...+++ ++-|.- |+....- ..-=...|.++||.. .|-.|.|+-. ..++-.| -++.|-||---
T Consensus 27 gyIAcgG~dGlLKVlKl~t~t~d~~~~glaa~snLsmNQtLeGH~~--sV~vvTWNe~---~QKLTtSDt~GlIiVWmly 101 (1189)
T KOG2041|consen 27 GYIACGGADGLLKVLKLGTDTTDLNKSGLAAASNLSMNQTLEGHNA--SVMVVTWNEN---NQKLTTSDTSGLIIVWMLY 101 (1189)
T ss_pred CeEEeccccceeEEEEccccCCcccccccccccccchhhhhccCcc--eEEEEEeccc---cccccccCCCceEEEEeee
Confidence 379999766554 443332 1111000 000135699999976 8999999996 5555555 36899999765
Q ss_pred CCCCCCCccceeeEEec-ccceEEEEeecCCCCeEEEEecc
Q 000080 127 SASSKGSFCWSQNAILV-QGTKVEAIEWTGSGDGIVAGGME 166 (2389)
Q Consensus 127 ~~~~kgd~~W~~~~tL~-hssTV~sIAWSpdG~rLaSggdD 166 (2389)
+| +|...-+-. -.|+|.+++|+.+|.+|.-+-.|
T Consensus 102 ----kg--sW~EEMiNnRnKSvV~SmsWn~dG~kIcIvYeD 136 (1189)
T KOG2041|consen 102 ----KG--SWCEEMINNRNKSVVVSMSWNLDGTKICIVYED 136 (1189)
T ss_pred ----cc--cHHHHHhhCcCccEEEEEEEcCCCcEEEEEEcc
Confidence 34 476543333 58899999999999999877666
No 298
>COG0823 TolB Periplasmic component of the Tol biopolymer transport system [Intracellular trafficking and secretion]
Probab=93.85 E-value=0.23 Score=63.60 Aligned_cols=143 Identities=15% Similarity=0.073 Sum_probs=92.2
Q ss_pred eeEEEEEEcCCCCeEEEEe---CC-CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEE-eCCCc
Q 000080 2220 ISTRAFSSHPLRPFFLVGS---SN-THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASA-ALDGT 2294 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS---~D-gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASg-S~DgT 2294 (2389)
..+..-+|+|+++.++--+ .. ..|.++|+.+|+....+. .+++ -..-+|||||++||-. ..||.
T Consensus 193 ~~~~~p~ws~~~~~~~y~~f~~~~~~~i~~~~l~~g~~~~i~~-~~g~----------~~~P~fspDG~~l~f~~~rdg~ 261 (425)
T COG0823 193 SLILTPAWSPDGKKLAYVSFELGGCPRIYYLDLNTGKRPVILN-FNGN----------NGAPAFSPDGSKLAFSSSRDGS 261 (425)
T ss_pred cceeccccCcCCCceEEEEEecCCCceEEEEeccCCccceeec-cCCc----------cCCccCCCCCCEEEEEECCCCC
Confidence 3456668999999765543 22 469999999998654442 2233 3556899999877755 45677
Q ss_pred EEEe--eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEE
Q 000080 2295 VCTW--QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLF 2372 (2389)
Q Consensus 2295 VkLW--Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~sv 2372 (2389)
..|| |+.++ +...+....|... .=.|+| ||+.|+-+. +.++.-+||-+. ..+..++.+.-+.+.-..-
T Consensus 262 ~~iy~~dl~~~---~~~~Lt~~~gi~~---~Ps~sp-dG~~ivf~S--dr~G~p~I~~~~-~~g~~~~riT~~~~~~~~p 331 (425)
T COG0823 262 PDIYLMDLDGK---NLPRLTNGFGINT---SPSWSP-DGSKIVFTS--DRGGRPQIYLYD-LEGSQVTRLTFSGGGNSNP 331 (425)
T ss_pred ccEEEEcCCCC---cceecccCCcccc---CccCCC-CCCEEEEEe--CCCCCcceEEEC-CCCCceeEeeccCCCCcCc
Confidence 6666 55543 1122233333332 445889 999999873 566666888774 3445556665555555577
Q ss_pred eecccchhhhc
Q 000080 2373 LPLKLLNFALS 2383 (2389)
Q Consensus 2373 A~~~~~~~~~s 2383 (2389)
..+|+|++++.
T Consensus 332 ~~SpdG~~i~~ 342 (425)
T COG0823 332 VWSPDGDKIVF 342 (425)
T ss_pred cCCCCCCEEEE
Confidence 88899988764
No 299
>PF07433 DUF1513: Protein of unknown function (DUF1513); InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=93.64 E-value=1.5 Score=54.33 Aligned_cols=148 Identities=19% Similarity=0.142 Sum_probs=92.3
Q ss_pred EEEEEcCCCCeEEEE--eCC-----CcEE-----------EeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCC
Q 000080 2223 RAFSSHPLRPFFLVG--SSN-----THIY-----------LWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGH 2284 (2389)
Q Consensus 2223 rsVAFsPdG~~LASG--S~D-----gTIR-----------LWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~ 2284 (2389)
..+.+.|||+.|+.+ +-. |..| .=|..+|+.+.... + |+.-|..+++-++.++||.
T Consensus 102 Hel~l~pDG~tLvVANGGI~Thpd~GR~kLNl~tM~psL~~ld~~sG~ll~q~~-L-----p~~~~~lSiRHLa~~~~G~ 175 (305)
T PF07433_consen 102 HELLLMPDGETLVVANGGIETHPDSGRAKLNLDTMQPSLVYLDARSGALLEQVE-L-----PPDLHQLSIRHLAVDGDGT 175 (305)
T ss_pred hhEEEcCCCCEEEEEcCCCccCcccCceecChhhcCCceEEEecCCCceeeeee-c-----CccccccceeeEEecCCCc
Confidence 566899999866654 322 2233 34556777655432 2 2233668899999999997
Q ss_pred EEEEEeCCCc-------EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCC
Q 000080 2285 RFASAALDGT-------VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTS 2357 (2389)
Q Consensus 2285 ~LASgS~DgT-------VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~ 2357 (2389)
.+...=..|- |-+++-...-+...-+-.......+.+-+|||++ +|.++|.+ +-..+.+-+||. .++.
T Consensus 176 V~~a~Q~qg~~~~~~PLva~~~~g~~~~~~~~p~~~~~~l~~Y~gSIa~~~-~g~~ia~t--sPrGg~~~~~d~--~tg~ 250 (305)
T PF07433_consen 176 VAFAMQYQGDPGDAPPLVALHRRGGALRLLPAPEEQWRRLNGYIGSIAADR-DGRLIAVT--SPRGGRVAVWDA--ATGR 250 (305)
T ss_pred EEEEEecCCCCCccCCeEEEEcCCCcceeccCChHHHHhhCCceEEEEEeC-CCCEEEEE--CCCCCEEEEEEC--CCCC
Confidence 6666544332 3344332210000001112344568899999999 88888765 479999999997 5666
Q ss_pred ceEEEEeecCcEEEEeecccchhhhcc
Q 000080 2358 SRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2358 ~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
.+....-.. +..||+..++ |.+|.
T Consensus 251 ~~~~~~l~D--~cGva~~~~~-f~~ss 274 (305)
T PF07433_consen 251 LLGSVPLPD--ACGVAPTDDG-FLVSS 274 (305)
T ss_pred EeeccccCc--eeeeeecCCc-eEEeC
Confidence 666554443 8888888888 77664
No 300
>PF02897 Peptidase_S9_N: Prolyl oligopeptidase, N-terminal beta-propeller domain; InterPro: IPR004106 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This entry represents the beta-propeller domain found at the N-terminal of prolyl oligopeptidase, including acylamino-acid-releasing enzyme (also known as acylaminoacyl peptidase), which belong to the MEROPS peptidase family S9 (clan SC), subfamily S9A. The prolyl oligopeptidase family consist of a number of evolutionary related peptidases whose catalytic activity seems to be provided by a charge relay system similar to that of the trypsin family of serine proteases, but which evolved by independent convergent evolution. The N-terminal domain of prolyl oligopeptidases form an unusual 7-bladed beta-propeller consisting of seven 4-stranded beta-sheet motifs. Prolyl oligopeptidase is a large cytosolic enzyme involved in the maturation and degradation of peptide hormones and neuropeptides, which relate to the induction of amnesia. The enzyme contains a peptidase domain, where its catalytic triad (Ser554, His680, Asp641) is covered by the central tunnel of the N-terminal beta-propeller domain. In this way, large structured peptides are excluded from the active site, thereby protecting larger peptides and proteins from proteolysis in the cytosol []. The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. Mammalian acylaminoacyl peptidase is an exopeptidase that is a member of the same prolyl oligopeptidase family of serine peptidases. This enzyme removes acylated amino acid residues from the N terminus of oligopeptides [].; GO: 0004252 serine-type endopeptidase activity, 0006508 proteolysis; PDB: 2BKL_B 3DDU_A 1YR2_A 2XE4_A 1VZ3_A 3EQ9_A 1O6F_A 3EQ7_A 4AN0_A 1UOP_A ....
Probab=93.62 E-value=2.4 Score=53.36 Aligned_cols=143 Identities=15% Similarity=0.099 Sum_probs=83.1
Q ss_pred eeEEEEEEcCCCCeEEEE-----eCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCC-
Q 000080 2220 ISTRAFSSHPLRPFFLVG-----SSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDG- 2293 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASG-----S~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~Dg- 2293 (2389)
..+...+++|||+++|-+ ++..+|++.|+.+|+.+..-- +. ..-..+.|.+||+.|.-...|.
T Consensus 124 ~~~~~~~~Spdg~~la~~~s~~G~e~~~l~v~Dl~tg~~l~d~i--~~---------~~~~~~~W~~d~~~~~y~~~~~~ 192 (414)
T PF02897_consen 124 VSLGGFSVSPDGKRLAYSLSDGGSEWYTLRVFDLETGKFLPDGI--EN---------PKFSSVSWSDDGKGFFYTRFDED 192 (414)
T ss_dssp EEEEEEEETTTSSEEEEEEEETTSSEEEEEEEETTTTEEEEEEE--EE---------EESEEEEECTTSSEEEEEECSTT
T ss_pred EEeeeeeECCCCCEEEEEecCCCCceEEEEEEECCCCcCcCCcc--cc---------cccceEEEeCCCCEEEEEEeCcc
Confidence 345678999999987743 344669999999998765421 11 1113499999999887776554
Q ss_pred ----------cEEEeeCCCCCccCcccceeeeecCCC--eeEEEEecCCCCEEEEeecCCCC-CeEEEeeCCCC--CCCc
Q 000080 2294 ----------TVCTWQLEVGGRSNVRPMESCLCFSSH--AMDVSYITSSGSVIAAAGHSSNG-INVVVWDTLAP--PTSS 2358 (2389)
Q Consensus 2294 ----------TVkLWDl~tggrs~~k~l~tl~gHs~~--V~sVAFSP~DGslLASAG~sS~D-~TVrLWD~l~~--tg~~ 2358 (2389)
.|++|.+.++. + ....-+++.... ..++..++ ||++|.....+..+ ..|.+=|+... ....
T Consensus 193 ~~~~~~~~~~~v~~~~~gt~~-~--~d~lvfe~~~~~~~~~~~~~s~-d~~~l~i~~~~~~~~s~v~~~d~~~~~~~~~~ 268 (414)
T PF02897_consen 193 QRTSDSGYPRQVYRHKLGTPQ-S--EDELVFEEPDEPFWFVSVSRSK-DGRYLFISSSSGTSESEVYLLDLDDGGSPDAK 268 (414)
T ss_dssp TSS-CCGCCEEEEEEETTS-G-G--G-EEEEC-TTCTTSEEEEEE-T-TSSEEEEEEESSSSEEEEEEEECCCTTTSS-S
T ss_pred cccccCCCCcEEEEEECCCCh-H--hCeeEEeecCCCcEEEEEEecC-cccEEEEEEEccccCCeEEEEeccccCCCcCC
Confidence 38899998752 1 212223333322 45788888 88987643323344 55777776311 1123
Q ss_pred eEEEEeecCcEEEEeeccc
Q 000080 2359 RASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus 2359 v~sL~GH~~~V~svA~~~~ 2377 (2389)
...+.-+..++....-+..
T Consensus 269 ~~~l~~~~~~~~~~v~~~~ 287 (414)
T PF02897_consen 269 PKLLSPREDGVEYYVDHHG 287 (414)
T ss_dssp EEEEEESSSS-EEEEEEET
T ss_pred cEEEeCCCCceEEEEEccC
Confidence 5555555555554443333
No 301
>PF08450 SGL: SMP-30/Gluconolaconase/LRE-like region; InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=93.15 E-value=2.4 Score=49.48 Aligned_cols=137 Identities=12% Similarity=0.078 Sum_probs=84.6
Q ss_pred EEEEcC-CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEEC-CCCCEEEEEeCCCcEEEeeCC
Q 000080 2224 AFSSHP-LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFD-HYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus 2224 sVAFsP-dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFS-PDG~~LASgS~DgTVkLWDl~ 2301 (2389)
.++|.+ +|.++.+.-..+.|.-||..+++.. .+. + .....+++. ++|+.+++ ..++ +.+.|.+
T Consensus 4 gp~~d~~~g~l~~~D~~~~~i~~~~~~~~~~~-~~~-~-----------~~~~G~~~~~~~g~l~v~-~~~~-~~~~d~~ 68 (246)
T PF08450_consen 4 GPVWDPRDGRLYWVDIPGGRIYRVDPDTGEVE-VID-L-----------PGPNGMAFDRPDGRLYVA-DSGG-IAVVDPD 68 (246)
T ss_dssp EEEEETTTTEEEEEETTTTEEEEEETTTTEEE-EEE-S-----------SSEEEEEEECTTSEEEEE-ETTC-EEEEETT
T ss_pred ceEEECCCCEEEEEEcCCCEEEEEECCCCeEE-EEe-c-----------CCCceEEEEccCCEEEEE-EcCc-eEEEecC
Confidence 458998 8888898889999999999776543 332 1 126788888 67655554 4444 4555998
Q ss_pred CCCccCcccceeee--e-cCCCeeEEEEecCCCCEEEEeecCCC-CCe--EEEeeCCCCCCCceEEEEeecCcEEEEeec
Q 000080 2302 VGGRSNVRPMESCL--C-FSSHAMDVSYITSSGSVIAAAGHSSN-GIN--VVVWDTLAPPTSSRASITCHEGLYDLFLPL 2375 (2389)
Q Consensus 2302 tggrs~~k~l~tl~--g-Hs~~V~sVAFSP~DGslLASAG~sS~-D~T--VrLWD~l~~tg~~v~sL~GH~~~V~svA~~ 2375 (2389)
++. .+.+.... . .....+++++.| +|++.+|...... ... =+||.+. +. ..+..+...-...+.++++
T Consensus 69 ~g~---~~~~~~~~~~~~~~~~~ND~~vd~-~G~ly~t~~~~~~~~~~~~g~v~~~~-~~-~~~~~~~~~~~~pNGi~~s 142 (246)
T PF08450_consen 69 TGK---VTVLADLPDGGVPFNRPNDVAVDP-DGNLYVTDSGGGGASGIDPGSVYRID-PD-GKVTVVADGLGFPNGIAFS 142 (246)
T ss_dssp TTE---EEEEEEEETTCSCTEEEEEEEE-T-TS-EEEEEECCBCTTCGGSEEEEEEE-TT-SEEEEEEEEESSEEEEEEE
T ss_pred CCc---EEEEeeccCCCcccCCCceEEEcC-CCCEEEEecCCCccccccccceEEEC-CC-CeEEEEecCcccccceEEC
Confidence 862 23444432 1 345678999999 9998887421100 000 2344442 22 3355555556777899999
Q ss_pred ccchhh
Q 000080 2376 KLLNFA 2381 (2389)
Q Consensus 2376 ~~~~~~ 2381 (2389)
++|+..
T Consensus 143 ~dg~~l 148 (246)
T PF08450_consen 143 PDGKTL 148 (246)
T ss_dssp TTSSEE
T ss_pred Ccchhe
Confidence 999853
No 302
>KOG1409 consensus Uncharacterized conserved protein, contains WD40 repeats and FYVE domains [Function unknown]
Probab=93.03 E-value=1 Score=55.78 Aligned_cols=158 Identities=13% Similarity=0.095 Sum_probs=110.3
Q ss_pred cccccccccccccCCC------CcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc----eeeEecccCCCCCCCCC
Q 000080 2200 GWETQDDFEDYVDPPA------TVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK----ATATYGVLPAANVPPPY 2269 (2389)
Q Consensus 2200 ~~d~~~~~~~~~d~~a------tv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk----~l~Tl~vl~gh~~p~~G 2269 (2389)
+.|.++|+|-=.|.-. +....+++++++++..+.|..|=++|++.-+-+...- .++.+ +.
T Consensus 43 s~drtvrv~lkrds~q~wpsI~~~mP~~~~~~~y~~e~~~L~vg~~ngtvtefs~sedfnkm~~~r~~----------~~ 112 (404)
T KOG1409|consen 43 SEDRTVRVWLKRDSGQYWPSIYHYMPSPCSAMEYVSESRRLYVGQDNGTVTEFALSEDFNKMTFLKDY----------LA 112 (404)
T ss_pred cccceeeeEEeccccccCchhhhhCCCCceEeeeeccceEEEEEEecceEEEEEhhhhhhhcchhhhh----------hh
Confidence 5566666663322222 2222467999999999999999999999998775432 22333 24
Q ss_pred CCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCC----------------------------C--------ccCccccee
Q 000080 2270 ALASISALQFDHYGHRFASAALDGTVCTWQLEVG----------------------------G--------RSNVRPMES 2313 (2389)
Q Consensus 2270 H~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tg----------------------------g--------rs~~k~l~t 2313 (2389)
|...|..+-|+---.++.+++.|..+.===.+.+ + .....++.+
T Consensus 113 h~~~v~~~if~~~~e~V~s~~~dk~~~~hc~e~~~~lg~Y~~~~~~t~~~~d~~~~fvGd~~gqvt~lr~~~~~~~~i~~ 192 (404)
T KOG1409|consen 113 HQARVSAIVFSLTHEWVLSTGKDKQFAWHCTESGNRLGGYNFETPASALQFDALYAFVGDHSGQITMLKLEQNGCQLITT 192 (404)
T ss_pred hhcceeeEEecCCceeEEEeccccceEEEeeccCCcccceEeeccCCCCceeeEEEEecccccceEEEEEeecCCceEEE
Confidence 6799999999988889999988866541111111 0 023467888
Q ss_pred eeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCc-eEEEEeecCcEEEEe
Q 000080 2314 CLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSS-RASITCHEGLYDLFL 2373 (2389)
Q Consensus 2314 l~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~-v~sL~GH~~~V~svA 2373 (2389)
+.+|.+.+++.++.| .-.+|-|+ +.|..|-+||+- -.+. ...++||.+.|+.+.
T Consensus 193 ~~~h~~~~~~l~Wd~-~~~~LfSg---~~d~~vi~wdig--g~~g~~~el~gh~~kV~~l~ 247 (404)
T KOG1409|consen 193 FNGHTGEVTCLKWDP-GQRLLFSG---ASDHSVIMWDIG--GRKGTAYELQGHNDKVQALS 247 (404)
T ss_pred EcCcccceEEEEEcC-CCcEEEec---cccCceEEEecc--CCcceeeeeccchhhhhhhh
Confidence 999999999999999 44666664 689999999983 2223 577899998887553
No 303
>KOG1920 consensus IkappaB kinase complex, IKAP component [Transcription]
Probab=92.96 E-value=1.9 Score=60.05 Aligned_cols=117 Identities=14% Similarity=0.173 Sum_probs=81.1
Q ss_pred HhccCCc-chhHHHHHHhcchHHHHHHHhcccCCCchhHHhHhh-cccChHHHHHHHHhhHHHHhhcchhHHHHHHHHhc
Q 000080 1258 YLKKKDP-KDCALLYIALNRIQVLAGLFKISKDEKDKPLVGFLS-RNFQEEKNKAAALKNAYVLLGRHQLELAIAFFLLG 1335 (2389)
Q Consensus 1258 y~~~kDP-~dcaLfYlAL~Kk~vL~gL~k~~~~~k~~~m~~FLs-nDFse~RWr~AAlKNAyaLLsK~Ry~~AAAFFLLA 1335 (2389)
+...+-+ .++||+|.-.||..--..-||.+++=++ .+.-.. -.+..+.-+.-|.+=+=.|.-+||+..||---++.
T Consensus 948 hL~~~~~~~~Aal~Ye~~GklekAl~a~~~~~dWr~--~l~~a~ql~~~~de~~~~a~~L~s~L~e~~kh~eAa~il~e~ 1025 (1265)
T KOG1920|consen 948 HLREELMSDEAALMYERCGKLEKALKAYKECGDWRE--ALSLAAQLSEGKDELVILAEELVSRLVEQRKHYEAAKILLEY 1025 (1265)
T ss_pred HHHHhccccHHHHHHHHhccHHHHHHHHHHhccHHH--HHHHHHhhcCCHHHHHHHHHHHHHHHHHcccchhHHHHHHHH
Confidence 3333334 4699999999999888888998775332 222222 25667777777788888888899998888777664
Q ss_pred -CChhHHHHHHHHhcCChhhhhhhhhhhccCCChhhHhhHhhhcccccc
Q 000080 1336 -GDAASAVTVCARNLGDVQLALVICRLVEKHGGPLERNLVTKFILPSSI 1383 (2389)
Q Consensus 1336 -g~lkDAV~Vc~~~L~D~qLAi~IaRLyEgd~gp~l~~lL~~~vLp~a~ 1383 (2389)
++.+.||.++++- .-..-|+-+|++++.++ ++++.+.|.+.
T Consensus 1026 ~sd~~~av~ll~ka-~~~~eAlrva~~~~~~d------~iee~l~~al~ 1067 (1265)
T KOG1920|consen 1026 LSDPEEAVALLCKA-KEWEEALRVASKAKRDD------IIEEVLKPALL 1067 (1265)
T ss_pred hcCHHHHHHHHhhH-hHHHHHHHHHHhcccch------HHHHHHhHHHH
Confidence 5788999998864 44556888888887553 45555544443
No 304
>COG5354 Uncharacterized protein, contains Trp-Asp (WD) repeat [General function prediction only]
Probab=92.92 E-value=0.32 Score=62.20 Aligned_cols=137 Identities=12% Similarity=0.123 Sum_probs=89.8
Q ss_pred CceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCC----
Q 000080 2218 ENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDG---- 2293 (2389)
Q Consensus 2218 ~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~Dg---- 2293 (2389)
++-+++.+.+||.|.+|++.-. .-|.+|+-..+..+..+. | ..|.-+.|||.|+.|.+=+...
T Consensus 31 ~~~p~~~~~~SP~G~~l~~~~~-~~V~~~~g~~~~~l~~~~-----------~-~~V~~~~fSP~~kYL~tw~~~pi~~p 97 (561)
T COG5354 31 ENWPVAYVSESPLGTYLFSEHA-AGVECWGGPSKAKLVRFR-----------H-PDVKYLDFSPNEKYLVTWSREPIIEP 97 (561)
T ss_pred cCcchhheeecCcchheehhhc-cceEEccccchhheeeee-----------c-CCceecccCcccceeeeeccCCccCh
Confidence 3457788999999999998544 459999977665444442 3 6699999999999999976543
Q ss_pred -----------cEEEeeCCCCCccCcccceeeeecCCC--ee-EEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCC--
Q 000080 2294 -----------TVCTWQLEVGGRSNVRPMESCLCFSSH--AM-DVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTS-- 2357 (2389)
Q Consensus 2294 -----------TVkLWDl~tggrs~~k~l~tl~gHs~~--V~-sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~-- 2357 (2389)
.+++||+.+| ..+.++.+-... .+ -+.|+- |..+.|=- -...+.|.++. +.-.
T Consensus 98 e~e~sp~~~~n~~~vwd~~sg-----~iv~sf~~~~q~~~~Wp~~k~s~-~D~y~ARv----v~~sl~i~e~t-~n~~~~ 166 (561)
T COG5354 98 EIEISPFTSKNNVFVWDIASG-----MIVFSFNGISQPYLGWPVLKFSI-DDKYVARV----VGSSLYIHEIT-DNIEEH 166 (561)
T ss_pred hhccCCccccCceeEEeccCc-----eeEeeccccCCcccccceeeeee-cchhhhhh----ccCeEEEEecC-CccccC
Confidence 4999999987 234444433333 34 467887 55766643 23468898841 1100
Q ss_pred ceEEEEeecCcEEEEeecccchh
Q 000080 2358 SRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus 2358 ~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
..+.|. ..+|..++.+|-||-
T Consensus 167 p~~~lr--~~gi~dFsisP~~n~ 187 (561)
T COG5354 167 PFKNLR--PVGILDFSISPEGNH 187 (561)
T ss_pred chhhcc--ccceeeEEecCCCCC
Confidence 022222 356777777776653
No 305
>KOG2314 consensus Translation initiation factor 3, subunit b (eIF-3b) [Translation, ribosomal structure and biogenesis]
Probab=92.63 E-value=0.52 Score=60.84 Aligned_cols=106 Identities=11% Similarity=0.177 Sum_probs=77.2
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-----------
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL----------- 2291 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~----------- 2291 (2389)
.-|.|||-|.+|+|=-.-| |.||-=.+-..++.| +| ..|.-|.|||.-++|+|=|.
T Consensus 214 tyv~wSP~GTYL~t~Hk~G-I~lWGG~~f~r~~RF-----------~H-p~Vq~idfSP~EkYLVT~s~~p~~~~~~d~e 280 (698)
T KOG2314|consen 214 TYVRWSPKGTYLVTFHKQG-IALWGGESFDRIQRF-----------YH-PGVQFIDFSPNEKYLVTYSPEPIIVEEDDNE 280 (698)
T ss_pred eeEEecCCceEEEEEeccc-eeeecCccHHHHHhc-----------cC-CCceeeecCCccceEEEecCCccccCcccCC
Confidence 4579999999999977666 899984433444544 24 55999999999999999653
Q ss_pred CCcEEEeeCCCCCccCcccceeeee--cCCCee-EEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2292 DGTVCTWQLEVGGRSNVRPMESCLC--FSSHAM-DVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2292 DgTVkLWDl~tggrs~~k~l~tl~g--Hs~~V~-sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
...+++||++||. ..+++.+ -...++ =+.||. |++++|.-+ .++|-|+++
T Consensus 281 ~~~l~IWDI~tG~-----lkrsF~~~~~~~~~WP~frWS~-DdKy~Arm~----~~sisIyEt 333 (698)
T KOG2314|consen 281 GQQLIIWDIATGL-----LKRSFPVIKSPYLKWPIFRWSH-DDKYFARMT----GNSISIYET 333 (698)
T ss_pred CceEEEEEccccc-----hhcceeccCCCccccceEEecc-CCceeEEec----cceEEEEec
Confidence 2679999999983 2333333 223333 377888 889999853 368999996
No 306
>PF12657 TFIIIC_delta: Transcription factor IIIC subunit delta N-term; InterPro: IPR024761 This entry represents a domain found towards the N terminus of the 90 kDa subunit of transcription factor IIIC (also known as subunit 9 in yeast []). The whole subunit is involved in RNA polymerase III-mediated transcription. It is possible that this N-terminal domain interacts with TFIIIC subunit 8 [].
Probab=92.41 E-value=1.3 Score=50.11 Aligned_cols=99 Identities=20% Similarity=0.274 Sum_probs=58.3
Q ss_pred CCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcc---------------c----ccccccccc-----eeeeeccCC
Q 000080 38 TRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLS---------------Q----EEALIGPIF-----RQVFALSDN 93 (2389)
Q Consensus 38 ~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~---------------~----~e~~~~p~~-----~Qviegh~d 93 (2389)
....++++||+| | -+|.+++..|.|+....|.. . .+.+.++.+ ....+...+
T Consensus 4 ps~~~~l~WS~D--g--~laV~t~~~v~IL~~~~P~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~p~~~~~~~~ 79 (173)
T PF12657_consen 4 PSCPNALAWSED--G--QLAVATGESVHILDPQTPNSLSKSFIPRPLTLPPSSIQWPITSIRRNLFTSSEWPTESPRSMD 79 (173)
T ss_pred CCCCcCeeECCC--C--CEEEEcCCeEEEEeccCCcccccccccCCcccccccCCCccceEecCccccccCceecccccc
Confidence 345689999999 7 59999999999993222330 0 111111222 011111111
Q ss_pred C-----CCeeEEEEcCC--CCCCCcEEE--ecCCeEEEEeeCCCCCCCCccceeeEEec
Q 000080 94 S-----LPVTSISWSPE--TPSIGQLAA--ASENCIFVFAHDSASSKGSFCWSQNAILV 143 (2389)
Q Consensus 94 ~-----~dVk~VaWSPd--~~~~GeIaA--SyDntIRVw~~d~~~~kgd~~W~~~~tL~ 143 (2389)
. ..|..++|||- .+.+++++| ..++.|.||.+.... .-.|.+...+.
T Consensus 80 ~~~~s~~~vv~~aWSP~Gl~~~~rClLavLTs~~~l~l~~~~~~~---~~~W~~v~dvs 135 (173)
T PF12657_consen 80 DEEISSSQVVSAAWSPSGLGPNGRCLLAVLTSNGRLSLYGPPGNP---QGEWNRVADVS 135 (173)
T ss_pred ccccccccEEEEEECCCCCCCCCceEEEEEcCCCeEEEEecCCCc---cccEeeeeehh
Confidence 0 26999999993 112245665 468999999987211 34688877664
No 307
>KOG2041 consensus WD40 repeat protein [General function prediction only]
Probab=92.30 E-value=0.62 Score=61.19 Aligned_cols=122 Identities=16% Similarity=0.225 Sum_probs=83.4
Q ss_pred cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCC-C----CCCCCCCCCEEEEEECCCCCEEEEEeC
Q 000080 2217 VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAA-N----VPPPYALASISALQFDHYGHRFASAAL 2291 (2389)
Q Consensus 2217 v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh-~----~p~~GH~~~V~sVaFSPDG~~LASgS~ 2291 (2389)
.+|+....++|+-+..+||.|+.||.+|+-.+++...-....++.+. + -..-||.+.|+-|.++.+.+.|-|...
T Consensus 12 PnnvkL~c~~WNke~gyIAcgG~dGlLKVlKl~t~t~d~~~~glaa~snLsmNQtLeGH~~sV~vvTWNe~~QKLTtSDt 91 (1189)
T KOG2041|consen 12 PNNVKLHCAEWNKESGYIACGGADGLLKVLKLGTDTTDLNKSGLAAASNLSMNQTLEGHNASVMVVTWNENNQKLTTSDT 91 (1189)
T ss_pred CCCceEEEEEEcccCCeEEeccccceeEEEEccccCCcccccccccccccchhhhhccCcceEEEEEeccccccccccCC
Confidence 34577789999999999999999999999988755321111110000 0 024578899999999999999999999
Q ss_pred CCcEEEeeCCCCCccCcccceeee--ecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080 2292 DGTVCTWQLEVGGRSNVRPMESCL--CFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus 2292 DgTVkLWDl~tggrs~~k~l~tl~--gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
+|-|-+|-+-.|. ....+. --.+-|.+++|.. ||+.|+-+ -+||.|-
T Consensus 92 ~GlIiVWmlykgs-----W~EEMiNnRnKSvV~SmsWn~-dG~kIcIv---YeDGavI 140 (1189)
T KOG2041|consen 92 SGLIIVWMLYKGS-----WCEEMINNRNKSVVVSMSWNL-DGTKICIV---YEDGAVI 140 (1189)
T ss_pred CceEEEEeeeccc-----HHHHHhhCcCccEEEEEEEcC-CCcEEEEE---EccCCEE
Confidence 9999999887651 111110 0123466777777 77777654 3555553
No 308
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=92.30 E-value=2.6 Score=53.18 Aligned_cols=121 Identities=9% Similarity=0.118 Sum_probs=76.8
Q ss_pred EEcC-CCCeEEEEeCCCcEEEeecCCCc-----eeeEeccc-CCCCCCCCCCCCCEEEEEECCCCCEEEEEe--------
Q 000080 2226 SSHP-LRPFFLVGSSNTHIYLWEFGKDK-----ATATYGVL-PAANVPPPYALASISALQFDHYGHRFASAA-------- 2290 (2389)
Q Consensus 2226 AFsP-dG~~LASGS~DgTIRLWDl~tGk-----~l~Tl~vl-~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-------- 2290 (2389)
.|.| ||+++..... |+|.+=|+.... ...++..- +.....| ....-++++|||+++-.+.
T Consensus 200 ~~~~~dg~~~~vs~e-G~V~~id~~~~~~~~~~~~~~~~~~~~~~~wrP----~g~q~ia~~~dg~~lyV~~~~~~~~th 274 (352)
T TIGR02658 200 AYSNKSGRLVWPTYT-GKIFQIDLSSGDAKFLPAIEAFTEAEKADGWRP----GGWQQVAYHRARDRIYLLADQRAKWTH 274 (352)
T ss_pred ceEcCCCcEEEEecC-CeEEEEecCCCcceecceeeeccccccccccCC----CcceeEEEcCCCCEEEEEecCCccccc
Confidence 4566 8887766555 999999964332 22222100 0000111 3345599999998877743
Q ss_pred --CCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCC-EEEEeecCCCCCeEEEeeCCCCCCCceEEE
Q 000080 2291 --LDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGS-VIAAAGHSSNGINVVVWDTLAPPTSSRASI 2362 (2389)
Q Consensus 2291 --~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGs-lLASAG~sS~D~TVrLWD~l~~tg~~v~sL 2362 (2389)
..+.|.++|.+++. .+..+. -...+..++|+| ||+ +|.++ ...+++|.+-|+ ++++.++++
T Consensus 275 k~~~~~V~ViD~~t~k-----vi~~i~-vG~~~~~iavS~-Dgkp~lyvt--n~~s~~VsViD~--~t~k~i~~i 338 (352)
T TIGR02658 275 KTASRFLFVVDAKTGK-----RLRKIE-LGHEIDSINVSQ-DAKPLLYAL--STGDKTLYIFDA--ETGKELSSV 338 (352)
T ss_pred cCCCCEEEEEECCCCe-----EEEEEe-CCCceeeEEECC-CCCeEEEEe--CCCCCcEEEEEC--cCCeEEeee
Confidence 22579999999862 333332 234788999999 888 66654 236788999997 566777776
No 309
>PF14783 BBS2_Mid: Ciliary BBSome complex subunit 2, middle region
Probab=92.25 E-value=3 Score=45.13 Aligned_cols=65 Identities=25% Similarity=0.219 Sum_probs=48.1
Q ss_pred EEEEEEcC---CCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEE
Q 000080 2222 TRAFSSHP---LRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCT 2297 (2389)
Q Consensus 2222 VrsVAFsP---dG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkL 2297 (2389)
|+++++.. ||+ .|+.||+|..||+|+ ....+..+.. .+.|.+++-... .+||-|-.+|||-+
T Consensus 2 V~al~~~d~d~dg~~eLlvGs~D~~IRvf~--~~e~~~Ei~e-----------~~~v~~L~~~~~-~~F~Y~l~NGTVGv 67 (111)
T PF14783_consen 2 VTALCLFDFDGDGENELLVGSDDFEIRVFK--GDEIVAEITE-----------TDKVTSLCSLGG-GRFAYALANGTVGV 67 (111)
T ss_pred eeEEEEEecCCCCcceEEEecCCcEEEEEe--CCcEEEEEec-----------ccceEEEEEcCC-CEEEEEecCCEEEE
Confidence 46666665 443 799999999999998 3466666641 266888877776 57999999998876
Q ss_pred eeC
Q 000080 2298 WQL 2300 (2389)
Q Consensus 2298 WDl 2300 (2389)
+|-
T Consensus 68 Y~~ 70 (111)
T PF14783_consen 68 YDR 70 (111)
T ss_pred EeC
Confidence 644
No 310
>KOG1645 consensus RING-finger-containing E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=92.05 E-value=0.25 Score=61.78 Aligned_cols=99 Identities=18% Similarity=0.241 Sum_probs=74.3
Q ss_pred CCCCCCEEEEEECCCCC-EEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080 2268 PYALASISALQFDHYGH-RFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus 2268 ~GH~~~V~sVaFSPDG~-~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
++|...|+.++|||..+ .+..++.+++|+|-|+++. ....++..| ..+++++|.-++...|- || -..|.|
T Consensus 190 p~~g~~IrdlafSp~~~GLl~~asl~nkiki~dlet~-----~~vssy~a~-~~~wSC~wDlde~h~IY-aG--l~nG~V 260 (463)
T KOG1645|consen 190 PGEGSFIRDLAFSPFNEGLLGLASLGNKIKIMDLETS-----CVVSSYIAY-NQIWSCCWDLDERHVIY-AG--LQNGMV 260 (463)
T ss_pred cccchhhhhhccCccccceeeeeccCceEEEEecccc-----eeeeheecc-CCceeeeeccCCcceeE-Ee--ccCceE
Confidence 45668899999999988 7999999999999999984 355666667 78999999996666665 45 378999
Q ss_pred EEeeCCCCCCCceEEEEe--ecCcEEEEeecc
Q 000080 2347 VVWDTLAPPTSSRASITC--HEGLYDLFLPLK 2376 (2389)
Q Consensus 2347 rLWD~l~~tg~~v~sL~G--H~~~V~svA~~~ 2376 (2389)
-++|+..+ ...++.+.+ -.+.|..|+|.+
T Consensus 261 lvyD~R~~-~~~~~e~~a~~t~~pv~~i~~~~ 291 (463)
T KOG1645|consen 261 LVYDMRQP-EGPLMELVANVTINPVHKIAPVQ 291 (463)
T ss_pred EEEEccCC-CchHhhhhhhhccCcceeecccC
Confidence 99999643 334555544 334566666543
No 311
>KOG1645 consensus RING-finger-containing E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=91.90 E-value=0.56 Score=58.89 Aligned_cols=111 Identities=14% Similarity=0.214 Sum_probs=80.2
Q ss_pred EEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEee
Q 000080 2222 TRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2222 VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWD 2299 (2389)
||.++|+|..+ ++..+|-+.+|+|.|+++-.++.+|. + | ..+++.+|.-|. +.+-.|...|.|.++|
T Consensus 196 IrdlafSp~~~GLl~~asl~nkiki~dlet~~~vssy~---a-------~-~~~wSC~wDlde~h~IYaGl~nG~VlvyD 264 (463)
T KOG1645|consen 196 IRDLAFSPFNEGLLGLASLGNKIKIMDLETSCVVSSYI---A-------Y-NQIWSCCWDLDERHVIYAGLQNGMVLVYD 264 (463)
T ss_pred hhhhccCccccceeeeeccCceEEEEecccceeeehee---c-------c-CCceeeeeccCCcceeEEeccCceEEEEE
Confidence 48899999988 88999999999999999888888874 2 2 679999999885 7888999999999999
Q ss_pred CCCCCccCcccceeeee--cCCCeeEEEEecC-----CCCEEEEeecCCCCCeEEEeeCC
Q 000080 2300 LEVGGRSNVRPMESCLC--FSSHAMDVSYITS-----SGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~g--Hs~~V~sVAFSP~-----DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
++... .++..+.+ -..+|-.|+..++ .|.+|+.+ +.+ ..-|++.
T Consensus 265 ~R~~~----~~~~e~~a~~t~~pv~~i~~~~~n~~f~~gglLv~~---lt~--l~f~ei~ 315 (463)
T KOG1645|consen 265 MRQPE----GPLMELVANVTINPVHKIAPVQPNKIFTSGGLLVFA---LTV--LQFYEIV 315 (463)
T ss_pred ccCCC----chHhhhhhhhccCcceeecccCccccccccceEEee---ehh--hhhhhhh
Confidence 98753 23333333 1223333333332 56777654 233 5678863
No 312
>KOG1912 consensus WD40 repeat protein [General function prediction only]
Probab=91.58 E-value=1 Score=60.10 Aligned_cols=128 Identities=12% Similarity=0.177 Sum_probs=87.6
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC------------CEEEEEe
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG------------HRFASAA 2290 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG------------~~LASgS 2290 (2389)
.++.|+|.| +||-|| ...|-+=|..+-+.++++. -|...|++|.+.|-- -.||+++
T Consensus 19 ~A~Dw~~~G-LiAygs-hslV~VVDs~s~q~iqsie----------~h~s~V~~VrWap~~~p~~llS~~~~~lliAsaD 86 (1062)
T KOG1912|consen 19 NAADWSPSG-LIAYGS-HSLVSVVDSRSLQLIQSIE----------LHQSAVTSVRWAPAPSPRDLLSPSSSQLLIASAD 86 (1062)
T ss_pred cccccCccc-eEEEec-CceEEEEehhhhhhhhccc----------cCccceeEEEeccCCCchhccCccccceeEEecc
Confidence 567999987 444444 4478899988778777763 256889999987632 2788999
Q ss_pred CCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecC--CC-CEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecC
Q 000080 2291 LDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITS--SG-SVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEG 2367 (2389)
Q Consensus 2291 ~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~--DG-slLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~ 2367 (2389)
..|.|-|||...+. ..--++.|.+.+-+++|.|. +. .+|+.= ..-.+|.||++ .+|+.+.....-+.
T Consensus 87 ~~GrIil~d~~~~s-----~~~~l~~~~~~~qdl~W~~~rd~Srd~LlaI---h~ss~lvLwnt--dtG~k~Wk~~ys~~ 156 (1062)
T KOG1912|consen 87 ISGRIILVDFVLAS-----VINWLSHSNDSVQDLCWVPARDDSRDVLLAI---HGSSTLVLWNT--DTGEKFWKYDYSHE 156 (1062)
T ss_pred ccCcEEEEEehhhh-----hhhhhcCCCcchhheeeeeccCcchheeEEe---cCCcEEEEEEc--cCCceeeccccCCc
Confidence 99999999999862 33445668899999999864 33 344332 23479999987 35666655443333
Q ss_pred cEEEE
Q 000080 2368 LYDLF 2372 (2389)
Q Consensus 2368 ~V~sv 2372 (2389)
-..|+
T Consensus 157 iLs~f 161 (1062)
T KOG1912|consen 157 ILSCF 161 (1062)
T ss_pred ceeee
Confidence 33333
No 313
>KOG3617 consensus WD40 and TPR repeat-containing protein [General function prediction only]
Probab=91.40 E-value=0.35 Score=64.26 Aligned_cols=107 Identities=15% Similarity=0.184 Sum_probs=82.5
Q ss_pred EEEcCCCCeEEEEe----CCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2225 FSSHPLRPFFLVGS----SNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2225 VAFsPdG~~LASGS----~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
++|||..|++|.+| ..|.|.|+- .+|+.-+... .|- | ++++++.|.--.||+|=+-|.+.+|..
T Consensus 21 ~SWHPsePlfAVA~fS~er~GSVtIfa-dtGEPqr~Vt-~P~-------h---atSLCWHpe~~vLa~gwe~g~~~v~~~ 88 (1416)
T KOG3617|consen 21 SSWHPSEPLFAVASFSPERGGSVTIFA-DTGEPQRDVT-YPV-------H---ATSLCWHPEEFVLAQGWEMGVSDVQKT 88 (1416)
T ss_pred cccCCCCceeEEEEecCCCCceEEEEe-cCCCCCcccc-cce-------e---hhhhccChHHHHHhhccccceeEEEec
Confidence 48999999999888 567888886 4666433221 122 2 688999999999999999999999988
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
++.+ ...-..-|...+.-+.||| +|+.|.|+ -.=+.|-+|...
T Consensus 89 ~~~e-----~htv~~th~a~i~~l~wS~-~G~~l~t~---d~~g~v~lwr~d 131 (1416)
T KOG3617|consen 89 NTTE-----THTVVETHPAPIQGLDWSH-DGTVLMTL---DNPGSVHLWRYD 131 (1416)
T ss_pred CCce-----eeeeccCCCCCceeEEecC-CCCeEEEc---CCCceeEEEEee
Confidence 7642 2222345889999999999 99999996 366789999974
No 314
>KOG4640 consensus Anaphase-promoting complex (APC), subunit 4 [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=91.37 E-value=0.58 Score=61.29 Aligned_cols=75 Identities=19% Similarity=0.252 Sum_probs=60.3
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
+.|..+.|+|--.+||.+..+|.|-+.-+. -+.+.++ |.||- +.++++++.|||+.||.|=.||||+|-|
T Consensus 21 ~~i~~~ewnP~~dLiA~~t~~gelli~R~n-~qRlwti--------p~p~~-~v~~sL~W~~DGkllaVg~kdG~I~L~D 90 (665)
T KOG4640|consen 21 INIKRIEWNPKMDLIATRTEKGELLIHRLN-WQRLWTI--------PIPGE-NVTASLCWRPDGKLLAVGFKDGTIRLHD 90 (665)
T ss_pred cceEEEEEcCccchhheeccCCcEEEEEec-cceeEec--------cCCCC-ccceeeeecCCCCEEEEEecCCeEEEEE
Confidence 356889999999999999999999887765 4455555 11221 2235999999999999999999999999
Q ss_pred CCCCC
Q 000080 2300 LEVGG 2304 (2389)
Q Consensus 2300 l~tgg 2304 (2389)
+++|+
T Consensus 91 ve~~~ 95 (665)
T KOG4640|consen 91 VEKGG 95 (665)
T ss_pred ccCCC
Confidence 99985
No 315
>PRK02888 nitrous-oxide reductase; Validated
Probab=90.93 E-value=1.8 Score=57.87 Aligned_cols=143 Identities=12% Similarity=0.114 Sum_probs=83.7
Q ss_pred cCCCCeEEEEeCCCcEEEeecCC----CceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEE-EeCCCcEEEeeCCC
Q 000080 2228 HPLRPFFLVGSSNTHIYLWEFGK----DKATATYGVLPAANVPPPYALASISALQFDHYGHRFAS-AALDGTVCTWQLEV 2302 (2389)
Q Consensus 2228 sPdG~~LASGS~DgTIRLWDl~t----Gk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LAS-gS~DgTVkLWDl~t 2302 (2389)
.++|++... .+++|.+.|..+ +..+..+- |.. ...+.|++||||+++.. +..+++|.+-|+++
T Consensus 285 vkdGK~~~V--~gn~V~VID~~t~~~~~~~v~~yI--PVG--------KsPHGV~vSPDGkylyVanklS~tVSVIDv~k 352 (635)
T PRK02888 285 VKAGKFKTI--GGSKVPVVDGRKAANAGSALTRYV--PVP--------KNPHGVNTSPDGKYFIANGKLSPTVTVIDVRK 352 (635)
T ss_pred hhCCCEEEE--CCCEEEEEECCccccCCcceEEEE--ECC--------CCccceEECCCCCEEEEeCCCCCcEEEEEChh
Confidence 346665444 367899999887 43333321 211 45689999999986655 55699999999987
Q ss_pred CCc---cCcccceeeeec---CCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCC----CC----CceEEEEeecCc
Q 000080 2303 GGR---SNVRPMESCLCF---SSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAP----PT----SSRASITCHEGL 2368 (2389)
Q Consensus 2303 ggr---s~~k~l~tl~gH---s~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~----tg----~~v~sL~GH~~~ 2368 (2389)
... ..+++-....+. ...-.-.+|.+ +|....|- --|..|..||+-.+ .| .-+..+.-|-+.
T Consensus 353 ~k~~~~~~~~~~~~vvaevevGlGPLHTaFDg-~G~aytsl---f~dsqv~kwn~~~a~~~~~g~~~~~v~~k~dV~y~p 428 (635)
T PRK02888 353 LDDLFDGKIKPRDAVVAEPELGLGPLHTAFDG-RGNAYTTL---FLDSQIVKWNIEAAIRAYKGEKVDPIVQKLDVHYQP 428 (635)
T ss_pred hhhhhhccCCccceEEEeeccCCCcceEEECC-CCCEEEeE---eecceeEEEehHHHHHHhccccCCcceecccCCCcc
Confidence 410 000111111110 11123477888 88866553 47889999997310 11 224445444433
Q ss_pred EEEE-----eecccchhhhcccc
Q 000080 2369 YDLF-----LPLKLLNFALSKCR 2386 (2389)
Q Consensus 2369 V~sv-----A~~~~~~~~~s~~~ 2386 (2389)
-... .-.++|.|.+|-|.
T Consensus 429 gh~~~~~g~t~~~dgk~l~~~nk 451 (635)
T PRK02888 429 GHNHASMGETKEADGKWLVSLNK 451 (635)
T ss_pred ceeeecCCCcCCCCCCEEEEccc
Confidence 3333 34789999988764
No 316
>PF15492 Nbas_N: Neuroblastoma-amplified sequence, N terminal
Probab=90.81 E-value=18 Score=44.61 Aligned_cols=213 Identities=15% Similarity=0.192 Sum_probs=111.0
Q ss_pred ccccccCCCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeec-cCCCCCeeEEEEcCCCC
Q 000080 29 RSEFIPTAPTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFAL-SDNSLPVTSISWSPETP 107 (2389)
Q Consensus 29 ~~~~ip~ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qvieg-h~d~~dVk~VaWSPd~~ 107 (2389)
....+|-.|-..=|.++|+|| + ..+|||.+++-|-.- +-+...-++|.|-- ..++ -. ..|..+.+-+-.-
T Consensus 34 ~kcqVpkD~~PQWRkl~WSpD--~-tlLa~a~S~G~i~vf--dl~g~~lf~I~p~~--~~~~d~~--~Aiagl~Fl~~~~ 104 (282)
T PF15492_consen 34 GKCQVPKDPNPQWRKLAWSPD--C-TLLAYAESTGTIRVF--DLMGSELFVIPPAM--SFPGDLS--DAIAGLIFLEYKK 104 (282)
T ss_pred EEEecCCCCCchheEEEECCC--C-cEEEEEcCCCeEEEE--ecccceeEEcCccc--ccCCccc--cceeeeEeecccc
Confidence 345678889999999999999 7 599999777766554 32222222322210 0111 01 2344444444210
Q ss_pred C----CCcEEEecCCeEEEEeeCCCCCCCCccceeeEEec----ccceEEEEeecCCCCeEEEEecc---eEEeeccCCc
Q 000080 108 S----IGQLAAASENCIFVFAHDSASSKGSFCWSQNAILV----QGTKVEAIEWTGSGDGIVAGGME---TVLWKKKNTL 176 (2389)
Q Consensus 108 ~----~GeIaASyDntIRVw~~d~~~~kgd~~W~~~~tL~----hssTV~sIAWSpdG~rLaSggdD---V~IW~~~~s~ 176 (2389)
+ .+-|+..|++.+|=|--..+.+ .. .....++. ...-|.++.|+|.-+.|+.||-. ..+++ ....
T Consensus 105 s~~ws~ELlvi~Y~G~L~Sy~vs~gt~-q~--y~e~hsfsf~~~yp~Gi~~~vy~p~h~LLlVgG~~~~~~~~s~-a~~~ 180 (282)
T PF15492_consen 105 SAQWSYELLVINYRGQLRSYLVSVGTN-QG--YQENHSFSFSSHYPHGINSAVYHPKHRLLLVGGCEQNQDGMSK-ASSC 180 (282)
T ss_pred ccccceeEEEEeccceeeeEEEEcccC-Cc--ceeeEEEEecccCCCceeEEEEcCCCCEEEEeccCCCCCcccc-cccc
Confidence 0 0234468998888886421111 11 22333332 36679999999988877766654 33443 2333
Q ss_pred EEEEEEeeccccceEE-EEeecCCCceEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCC
Q 000080 177 WEIAWKFKENYPQNLV-SATWSIEGPSATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTR 255 (2389)
Q Consensus 177 Wecvwt~~~~~~~~iv-svaWSpdG~fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~ 255 (2389)
.-++|+.-.. .+.| .+. +-+..+.+......|.+- + ...+......-..-|..+.=+|
T Consensus 181 GLtaWRiL~~--~Pyyk~v~-~~~~~~~~~~~~~~~~~~-------~--------~~~~fs~~~~~~d~i~kmSlSP--- 239 (282)
T PF15492_consen 181 GLTAWRILSD--SPYYKQVT-SSEDDITASSKRRGLLRI-------P--------SFKFFSRQGQEQDGIFKMSLSP--- 239 (282)
T ss_pred CceEEEEcCC--CCcEEEcc-ccCccccccccccceeec-------c--------ceeeeeccccCCCceEEEEECC---
Confidence 4444543222 2333 232 111112111110001000 0 0000001122235678889999
Q ss_pred CCCCCCCccccCceEEeeecCCeEEEEEee
Q 000080 256 RHSPGDTKRSQRHVLLTCCLDGTVRLWCEM 285 (2389)
Q Consensus 256 ~~~~~Dgk~~~~nILAScSdDgTVRLW~e~ 285 (2389)
||+. ||++..+|.+-||++-
T Consensus 240 -----dg~~-----La~ih~sG~lsLW~iP 259 (282)
T PF15492_consen 240 -----DGSL-----LACIHFSGSLSLWEIP 259 (282)
T ss_pred -----CCCE-----EEEEEcCCeEEEEecC
Confidence 7777 9999999999999954
No 317
>PF07433 DUF1513: Protein of unknown function (DUF1513); InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=90.78 E-value=1.7 Score=53.75 Aligned_cols=143 Identities=10% Similarity=0.049 Sum_probs=89.4
Q ss_pred EEEEEcCC-CCeEEEEeCCCc-EEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-----CCcE
Q 000080 2223 RAFSSHPL-RPFFLVGSSNTH-IYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-----DGTV 2295 (2389)
Q Consensus 2223 rsVAFsPd-G~~LASGS~DgT-IRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-----DgTV 2295 (2389)
..++.||+ +..++-+-.-|+ ..+||..+|+.++.+..- +|+ ..-=--.|||||++|-+.-. .|.|
T Consensus 8 H~~a~~p~~~~avafaRRPG~~~~v~D~~~g~~~~~~~a~-------~gR-HFyGHg~fs~dG~~LytTEnd~~~g~G~I 79 (305)
T PF07433_consen 8 HGVAAHPTRPEAVAFARRPGTFALVFDCRTGQLLQRLWAP-------PGR-HFYGHGVFSPDGRLLYTTENDYETGRGVI 79 (305)
T ss_pred cceeeCCCCCeEEEEEeCCCcEEEEEEcCCCceeeEEcCC-------CCC-EEecCEEEcCCCCEEEEeccccCCCcEEE
Confidence 56799995 446777777666 589999999988877421 221 22223579999999988654 4899
Q ss_pred EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCC-----CCCeEEEee-C-------C-CCCCCceE-
Q 000080 2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSS-----NGINVVVWD-T-------L-APPTSSRA- 2360 (2389)
Q Consensus 2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS-----~D~TVrLWD-~-------l-~~tg~~v~- 2360 (2389)
-+||++.+ .+.+..+..|.-.--++.+.| ||+.|+.|= ++ +.+-.||.= + + ..+|+.+.
T Consensus 80 gVyd~~~~----~~ri~E~~s~GIGPHel~l~p-DG~tLvVAN-GGI~Thpd~GR~kLNl~tM~psL~~ld~~sG~ll~q 153 (305)
T PF07433_consen 80 GVYDAARG----YRRIGEFPSHGIGPHELLLMP-DGETLVVAN-GGIETHPDSGRAKLNLDTMQPSLVYLDARSGALLEQ 153 (305)
T ss_pred EEEECcCC----cEEEeEecCCCcChhhEEEcC-CCCEEEEEc-CCCccCcccCceecChhhcCCceEEEecCCCceeee
Confidence 99999832 144555555554445788999 886666541 11 111223321 1 1 23455543
Q ss_pred -EE--EeecCcEEEEeecccch
Q 000080 2361 -SI--TCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus 2361 -sL--~GH~~~V~svA~~~~~~ 2379 (2389)
.| .-|...++=+|...+|.
T Consensus 154 ~~Lp~~~~~lSiRHLa~~~~G~ 175 (305)
T PF07433_consen 154 VELPPDLHQLSIRHLAVDGDGT 175 (305)
T ss_pred eecCccccccceeeEEecCCCc
Confidence 35 45777787777777765
No 318
>KOG2695 consensus WD40 repeat protein [General function prediction only]
Probab=90.44 E-value=0.4 Score=59.18 Aligned_cols=118 Identities=14% Similarity=0.146 Sum_probs=83.8
Q ss_pred EEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceee
Q 000080 2235 LVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESC 2314 (2389)
Q Consensus 2235 ASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl 2314 (2389)
++.+.+..|-|=|+++|-. +.|. ..+.|.+.+|.--++.+-.|...|.|-.-|++.+-+-+..+...
T Consensus 228 fs~G~sqqv~L~nvetg~~-qsf~-----------sksDVfAlQf~~s~nLv~~GcRngeI~~iDLR~rnqG~~~~a~r- 294 (425)
T KOG2695|consen 228 FSVGLSQQVLLTNVETGHQ-QSFQ-----------SKSDVFALQFAGSDNLVFNGCRNGEIFVIDLRCRNQGNGWCAQR- 294 (425)
T ss_pred ecccccceeEEEEeecccc-cccc-----------cchhHHHHHhcccCCeeEecccCCcEEEEEeeecccCCCcceEE-
Confidence 4556777888888887743 2332 24779999999999999999999999999999852111122222
Q ss_pred eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCc---eEEEEeecCcEE
Q 000080 2315 LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSS---RASITCHEGLYD 2370 (2389)
Q Consensus 2315 ~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~---v~sL~GH~~~V~ 2370 (2389)
.-|...|.++..-.-+++.|.++ +.+++|+|||... .+| |++.+||.|.-.
T Consensus 295 lyh~Ssvtslq~Lq~s~q~LmaS---~M~gkikLyD~R~--~K~~~~V~qYeGHvN~~a 348 (425)
T KOG2695|consen 295 LYHDSSVTSLQILQFSQQKLMAS---DMTGKIKLYDLRA--TKCKKSVMQYEGHVNLSA 348 (425)
T ss_pred EEcCcchhhhhhhccccceEeec---cCcCceeEeeehh--hhcccceeeeeccccccc
Confidence 23888888776654355666653 5899999999853 345 899999976544
No 319
>KOG1832 consensus HIV-1 Vpr-binding protein [Cell cycle control, cell division, chromosome partitioning]
Probab=90.31 E-value=0.33 Score=64.81 Aligned_cols=105 Identities=18% Similarity=0.157 Sum_probs=78.9
Q ss_pred CCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEe
Q 000080 2270 ALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVW 2349 (2389)
Q Consensus 2270 H~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLW 2349 (2389)
|...-++++||-+.+.|+.|+..|.|++.++.+| .......||+..|.-|-=+- ||.++.|.+. +.--...||
T Consensus 1100 ~~~~fTc~afs~~~~hL~vG~~~Geik~~nv~sG-----~~e~s~ncH~SavT~vePs~-dgs~~Ltsss-~S~PlsaLW 1172 (1516)
T KOG1832|consen 1100 ETALFTCIAFSGGTNHLAVGSHAGEIKIFNVSSG-----SMEESVNCHQSAVTLVEPSV-DGSTQLTSSS-SSSPLSALW 1172 (1516)
T ss_pred cccceeeEEeecCCceEEeeeccceEEEEEccCc-----cccccccccccccccccccC-Ccceeeeecc-ccCchHHHh
Confidence 4477899999999999999999999999999997 35567789999999888888 8888877542 233368899
Q ss_pred eCCCCCCCceEEEEeecCcEEEEeeccc-chhhhcccc
Q 000080 2350 DTLAPPTSSRASITCHEGLYDLFLPLKL-LNFALSKCR 2386 (2389)
Q Consensus 2350 D~l~~tg~~v~sL~GH~~~V~svA~~~~-~~~~~s~~~ 2386 (2389)
|+- .+++.++++.+-. ++-|+.. -.+||+.|+
T Consensus 1173 ~~~-s~~~~~Hsf~ed~----~vkFsn~~q~r~~gt~~ 1205 (1516)
T KOG1832|consen 1173 DAS-STGGPRHSFDEDK----AVKFSNSLQFRALGTEA 1205 (1516)
T ss_pred ccc-cccCccccccccc----eeehhhhHHHHHhcccc
Confidence 984 4666788886432 3444433 345666654
No 320
>COG5354 Uncharacterized protein, contains Trp-Asp (WD) repeat [General function prediction only]
Probab=89.69 E-value=3.1 Score=53.85 Aligned_cols=136 Identities=13% Similarity=0.131 Sum_probs=92.5
Q ss_pred EEEEcCCCCeEEEEe-----------CCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe--
Q 000080 2224 AFSSHPLRPFFLVGS-----------SNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA-- 2290 (2389)
Q Consensus 2224 sVAFsPdG~~LASGS-----------~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-- 2290 (2389)
.+-|++.|.+|+.=- ...+++|.++. ++-++... +-.+.|...+|+|++++||..+
T Consensus 227 qLkW~~~g~~ll~l~~t~~ksnKsyfgesnLyl~~~~-e~~i~V~~----------~~~~pVhdf~W~p~S~~F~vi~g~ 295 (561)
T COG5354 227 QLKWQVLGKYLLVLVMTHTKSNKSYFGESNLYLLRIT-ERSIPVEK----------DLKDPVHDFTWEPLSSRFAVISGY 295 (561)
T ss_pred EEEEecCCceEEEEEEEeeecccceeccceEEEEeec-ccccceec----------cccccceeeeecccCCceeEEecc
Confidence 568899999765311 23567888875 44333221 1247799999999999999876
Q ss_pred CCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEE
Q 000080 2291 LDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYD 2370 (2389)
Q Consensus 2291 ~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~ 2370 (2389)
.+-++.+.|++.. ++ +-..+..=+.+.|+| .++++..||++-.-++|.+||.. ..-.++..+.+-. .+
T Consensus 296 ~pa~~s~~~lr~N----l~----~~~Pe~~rNT~~fsp-~~r~il~agF~nl~gni~i~~~~-~rf~~~~~~~~~n--~s 363 (561)
T COG5354 296 MPASVSVFDLRGN----LR----FYFPEQKRNTIFFSP-HERYILFAGFDNLQGNIEIFDPA-GRFKVAGAFNGLN--TS 363 (561)
T ss_pred cccceeecccccc----eE----EecCCcccccccccC-cccEEEEecCCccccceEEeccC-CceEEEEEeecCC--ce
Confidence 7889999999742 11 122344445678999 89999999999889999999962 1112344666543 44
Q ss_pred EEeecccchhhh
Q 000080 2371 LFLPLKLLNFAL 2382 (2389)
Q Consensus 2371 svA~~~~~~~~~ 2382 (2389)
-...+|+|.|..
T Consensus 364 ~~~wspd~qF~~ 375 (561)
T COG5354 364 YCDWSPDGQFYD 375 (561)
T ss_pred EeeccCCceEEE
Confidence 556778887754
No 321
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=89.61 E-value=2.3 Score=52.76 Aligned_cols=113 Identities=8% Similarity=-0.049 Sum_probs=72.6
Q ss_pred CCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCccc
Q 000080 2231 RPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRP 2310 (2389)
Q Consensus 2231 G~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~ 2310 (2389)
+..+..++.|+.++.||..+|+.+-.... . . .. .+..+|+++..++.||.|..+|..+|. .
T Consensus 241 ~~~vy~~~~~g~l~a~d~~tG~~~W~~~~--------~---~-~~--~p~~~~~~vyv~~~~G~l~~~d~~tG~-----~ 301 (377)
T TIGR03300 241 GGQVYAVSYQGRVAALDLRSGRVLWKRDA--------S---S-YQ--GPAVDDNRLYVTDADGVVVALDRRSGS-----E 301 (377)
T ss_pred CCEEEEEEcCCEEEEEECCCCcEEEeecc--------C---C-cc--CceEeCCEEEEECCCCeEEEEECCCCc-----E
Confidence 45677788999999999999987765421 0 1 11 122357778888899999999999873 2
Q ss_pred ceeeeecCCC-eeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEE
Q 000080 2311 MESCLCFSSH-AMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYD 2370 (2389)
Q Consensus 2311 l~tl~gHs~~-V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~ 2370 (2389)
+.......+. ..+.+. .|..|.++ +.|+.|.++|. .+++.+.++.-|...+.
T Consensus 302 ~W~~~~~~~~~~ssp~i---~g~~l~~~---~~~G~l~~~d~--~tG~~~~~~~~~~~~~~ 354 (377)
T TIGR03300 302 LWKNDELKYRQLTAPAV---VGGYLVVG---DFEGYLHWLSR--EDGSFVARLKTDGSGIA 354 (377)
T ss_pred EEccccccCCccccCEE---ECCEEEEE---eCCCEEEEEEC--CCCCEEEEEEcCCCccc
Confidence 2222111111 112222 24566654 48899999997 56888888876665443
No 322
>PF08553 VID27: VID27 cytoplasmic protein; InterPro: IPR013863 This entry represents fungal and plant proteins and contains many hypothetical proteins. Vid27p is a cytoplasmic protein of unknown function, possibly regulates import of fructose-1,6-bisphosphatase into Vacuolar Import and Degradation (Vid) vesicles and is not essential for proteasome-dependent degradation of fructose-1,6-bisphosphatase (FBPase) [, ].
Probab=88.90 E-value=2.3 Score=58.33 Aligned_cols=129 Identities=11% Similarity=0.126 Sum_probs=86.6
Q ss_pred EEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-------CCEEEEEeCCCcEEEeeCCCCCccCc
Q 000080 2236 VGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-------GHRFASAALDGTVCTWQLEVGGRSNV 2308 (2389)
Q Consensus 2236 SGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-------G~~LASgS~DgTVkLWDl~tggrs~~ 2308 (2389)
.......|+--|+.+|+-+..+.+ |. ...|. .|.|+ ...-..|=.++.+..||.+..+.
T Consensus 499 ~~~~~~~ly~mDLe~GKVV~eW~~---~~------~~~v~--~~~p~~K~aqlt~e~tflGls~n~lfriDpR~~~~--- 564 (794)
T PF08553_consen 499 DPNNPNKLYKMDLERGKVVEEWKV---HD------DIPVV--DIAPDSKFAQLTNEQTFLGLSDNSLFRIDPRLSGN--- 564 (794)
T ss_pred cCCCCCceEEEecCCCcEEEEeec---CC------Cccee--EecccccccccCCCceEEEECCCceEEeccCCCCC---
Confidence 334677899999999999999863 21 12244 44443 22345567788999999997541
Q ss_pred ccceeeeecC----CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080 2309 RPMESCLCFS----SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2309 k~l~tl~gHs----~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
+.+. -+.|. ..-.++|-.. +|. ||.| |.+|-|||+|-+ ..+.-..|.|--.+|..|..+.+|+|+|--
T Consensus 565 k~v~-~~~k~Y~~~~~Fs~~aTt~-~G~-iavg---s~~G~IRLyd~~--g~~AKT~lp~lG~pI~~iDvt~DGkwilaT 636 (794)
T PF08553_consen 565 KLVD-SQSKQYSSKNNFSCFATTE-DGY-IAVG---SNKGDIRLYDRL--GKRAKTALPGLGDPIIGIDVTADGKWILAT 636 (794)
T ss_pred ceee-ccccccccCCCceEEEecC-Cce-EEEE---eCCCcEEeeccc--chhhhhcCCCCCCCeeEEEecCCCcEEEEe
Confidence 2221 12222 2334566665 665 5554 699999999953 123345677878999999999999999999
Q ss_pred cc
Q 000080 2385 CR 2386 (2389)
Q Consensus 2385 ~~ 2386 (2389)
|+
T Consensus 637 c~ 638 (794)
T PF08553_consen 637 CK 638 (794)
T ss_pred ec
Confidence 96
No 323
>PF00930 DPPIV_N: Dipeptidyl peptidase IV (DPP IV) N-terminal region; InterPro: IPR002469 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This domain defines serine peptidases belonging to MEROPS peptidase family S9 (clan SC), subfamily S9B (dipeptidyl-peptidase IV). The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. This domain is an alignment of the region to the N-terminal side of the active site, which is found in IPR001375 from INTERPRO. CD26 (3.4.14.5 from EC) is also called adenosine deaminase-binding protein (ADA-binding protein) or dipeptidylpeptidase IV (DPP IV ectoenzyme). The exopeptidase cleaves off N-terminal X-Pro or X-Ala dipeptides from polypeptides (dipeptidyl peptidase IV activity). CD26 serves as the costimulatory molecule in T cell activation and is an associated marker of autoimmune diseases, adenosine deaminase-deficiency and HIV pathogenesis. Dipeptidyl peptidase IV (DPP IV) is responsible for the removal of N-terminal dipeptides sequentially from polypeptides having unsubstituted N termini, provided that the penultimate residue is proline. The enzyme catalyses the reaction: Dipeptidyl-Polypeptide + H(2)O = Dipeptide + Polypeptide It is a type II membrane protein that forms a homodimer. CD molecules are leucocyte antigens on cell surfaces. CD antigens nomenclature is updated at Protein Reviews On The Web (http://prow.nci.nih.gov/). ; GO: 0006508 proteolysis, 0016020 membrane; PDB: 2RIP_A 3Q8W_B 2AJL_I 1TKR_B 1TK3_B 3C45_A 2G5P_A 3G0C_D 1R9M_C 1RWQ_A ....
Probab=88.37 E-value=0.82 Score=56.75 Aligned_cols=105 Identities=12% Similarity=0.089 Sum_probs=66.9
Q ss_pred cCCCCeEEEE---------eCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080 2228 HPLRPFFLVG---------SSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus 2228 sPdG~~LASG---------S~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
||||++++-. |..+.+.++|+.+++...... . ...+....+||||+.+|-... +-|.++
T Consensus 1 S~d~~~~l~~~~~~~~~r~s~~~~y~i~d~~~~~~~~l~~---~--------~~~~~~~~~sP~g~~~~~v~~-~nly~~ 68 (353)
T PF00930_consen 1 SPDGKFVLFATNYTKQWRHSFKGDYYIYDIETGEITPLTP---P--------PPKLQDAKWSPDGKYIAFVRD-NNLYLR 68 (353)
T ss_dssp -TTSSEEEEEEEEEEESSSEEEEEEEEEETTTTEEEESS----E--------ETTBSEEEE-SSSTEEEEEET-TEEEEE
T ss_pred CCCCCeEEEEECcEEeeeeccceeEEEEecCCCceEECcC---C--------ccccccceeecCCCeeEEEec-CceEEE
Confidence 6888877662 345789999999887554321 0 256889999999999999975 779999
Q ss_pred eCCCCCccCcccceeeeec----------------CCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2299 QLEVGGRSNVRPMESCLCF----------------SSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~tl~gH----------------s~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
++.++. ..-.|..|- -+.-..+-||| ||+.||..- -+++.|+.+.+
T Consensus 69 ~~~~~~----~~~lT~dg~~~i~nG~~dwvyeEEv~~~~~~~~WSp-d~~~la~~~--~d~~~v~~~~~ 130 (353)
T PF00930_consen 69 DLATGQ----ETQLTTDGEPGIYNGVPDWVYEEEVFDRRSAVWWSP-DSKYLAFLR--FDEREVPEYPL 130 (353)
T ss_dssp SSTTSE----EEESES--TTTEEESB--HHHHHHTSSSSBSEEE-T-TSSEEEEEE--EE-TTS-EEEE
T ss_pred ECCCCC----eEEeccccceeEEcCccceeccccccccccceEECC-CCCEEEEEE--ECCcCCceEEe
Confidence 887652 111122220 01124577999 999999875 36777777765
No 324
>KOG1916 consensus Nuclear protein, contains WD40 repeats [General function prediction only]
Probab=88.35 E-value=0.3 Score=65.51 Aligned_cols=133 Identities=14% Similarity=0.194 Sum_probs=81.8
Q ss_pred EEEEEEcC---CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEE-----------ECCCCCEEE
Q 000080 2222 TRAFSSHP---LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQ-----------FDHYGHRFA 2287 (2389)
Q Consensus 2222 VrsVAFsP---dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVa-----------FSPDG~~LA 2287 (2389)
++-|.|.| +.-++-.|-.|++|+|-++.+... .-++ +|..+|..++ .||||+.||
T Consensus 183 ~~~V~wcp~~~~~~~ic~~~~~~~i~lL~~~ra~~-~l~r----------sHs~~~~d~a~~~~g~~~l~~lSpDGtv~a 251 (1283)
T KOG1916|consen 183 PQLVSWCPIAVNKVYICYGLKGGEIRLLNINRALR-SLFR----------SHSQRVTDMAFFAEGVLKLASLSPDGTVFA 251 (1283)
T ss_pred cceeeecccccccceeeeccCCCceeEeeechHHH-HHHH----------hcCCCcccHHHHhhchhhheeeCCCCcEEE
Confidence 35556655 456777888999999988864432 2222 2445555543 589999999
Q ss_pred EEeCCCcEEEeeCCCCCccCcccceeee-----------ecCCC--eeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCC
Q 000080 2288 SAALDGTVCTWQLEVGGRSNVRPMESCL-----------CFSSH--AMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAP 2354 (2389)
Q Consensus 2288 SgS~DgTVkLWDl~tggrs~~k~l~tl~-----------gHs~~--V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~ 2354 (2389)
.++.||.|+.|++.-.|+-.++++..+. ||... +.++.|.. ++.++. -.++-+++|.. .
T Consensus 252 ~a~~dG~v~f~Qiyi~g~~~~rclhewkphd~~p~vC~lc~~~~~~~v~i~~w~----~~Ittt--d~nre~k~w~~--a 323 (1283)
T KOG1916|consen 252 WAISDGSVGFYQIYITGKIVHRCLHEWKPHDKHPRVCWLCHKQEILVVSIGKWV----LRITTT--DVNREEKFWAE--A 323 (1283)
T ss_pred EeecCCccceeeeeeeccccHhhhhccCCCCCCCceeeeeccccccCCccceeE----EEEecc--cCCcceeEeec--c
Confidence 9999999999998543321222222222 33322 22333332 444532 36677999997 4
Q ss_pred CCCceEEEEeecCcEEEEeec
Q 000080 2355 PTSSRASITCHEGLYDLFLPL 2375 (2389)
Q Consensus 2355 tg~~v~sL~GH~~~V~svA~~ 2375 (2389)
.-+|+ |.--.+.|..|+|+
T Consensus 324 ~w~Cl--l~~~~d~v~iV~p~ 342 (1283)
T KOG1916|consen 324 PWQCL--LDKLIDGVQIVGPH 342 (1283)
T ss_pred chhhh--hhhcccceEeecCC
Confidence 55665 44455678888865
No 325
>PF12657 TFIIIC_delta: Transcription factor IIIC subunit delta N-term; InterPro: IPR024761 This entry represents a domain found towards the N terminus of the 90 kDa subunit of transcription factor IIIC (also known as subunit 9 in yeast []). The whole subunit is involved in RNA polymerase III-mediated transcription. It is possible that this N-terminal domain interacts with TFIIIC subunit 8 [].
Probab=87.80 E-value=3.9 Score=46.39 Aligned_cols=82 Identities=20% Similarity=0.383 Sum_probs=51.4
Q ss_pred eEEEEcCCCCCCCcEEEecCCeEEEE---eeC-------CC---CCCCCccceeeEEe-------------c--------
Q 000080 98 TSISWSPETPSIGQLAAASENCIFVF---AHD-------SA---SSKGSFCWSQNAIL-------------V-------- 143 (2389)
Q Consensus 98 k~VaWSPd~~~~GeIaASyDntIRVw---~~d-------~~---~~kgd~~W~~~~tL-------------~-------- 143 (2389)
-+++||+| |+||+..++.|-|. .|. .. .......|...... .
T Consensus 8 ~~l~WS~D----g~laV~t~~~v~IL~~~~P~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~p~~~~~~~~~~~~ 83 (173)
T PF12657_consen 8 NALAWSED----GQLAVATGESVHILDPQTPNSLSKSFIPRPLTLPPSSIQWPITSIRRNLFTSSEWPTESPRSMDDEEI 83 (173)
T ss_pred cCeeECCC----CCEEEEcCCeEEEEeccCCcccccccccCCcccccccCCCccceEecCccccccCceecccccccccc
Confidence 47999998 89999999999999 433 00 00001112111110 0
Q ss_pred ccceEEEEeecCCCC------eEEEEecc--eEEeecc---CCcEEEEEEe
Q 000080 144 QGTKVEAIEWTGSGD------GIVAGGME--TVLWKKK---NTLWEIAWKF 183 (2389)
Q Consensus 144 hssTV~sIAWSpdG~------rLaSggdD--V~IW~~~---~s~Wecvwt~ 183 (2389)
.++.|.+++|||.|- .||....+ +.||... .+.|..+.-+
T Consensus 84 s~~~vv~~aWSP~Gl~~~~rClLavLTs~~~l~l~~~~~~~~~~W~~v~dv 134 (173)
T PF12657_consen 84 SSSQVVSAAWSPSGLGPNGRCLLAVLTSNGRLSLYGPPGNPQGEWNRVADV 134 (173)
T ss_pred ccccEEEEEECCCCCCCCCceEEEEEcCCCeEEEEecCCCccccEeeeeeh
Confidence 124899999999763 34444444 9999965 6788887654
No 326
>COG5170 CDC55 Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=87.65 E-value=2.1 Score=52.55 Aligned_cols=127 Identities=15% Similarity=0.254 Sum_probs=82.6
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc-eee-EecccCCCCCCC-----CCCCCCEEEEEEC-CCC-CEEEEEeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK-ATA-TYGVLPAANVPP-----PYALASISALQFD-HYG-HRFASAAL 2291 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk-~l~-Tl~vl~gh~~p~-----~GH~~~V~sVaFS-PDG-~~LASgS~ 2291 (2389)
-|.+|-|.-.|.+||+|--.|.|-+++-.... |-. -|..+++|..-. .--...|..|.+- |.| +.|.-...
T Consensus 28 ~ItaVefd~tg~YlatGDkgGRVvlfer~~s~~ceykf~teFQshe~EFDYLkSleieEKin~I~w~~~t~r~hFLlstN 107 (460)
T COG5170 28 KITAVEFDETGLYLATGDKGGRVVLFEREKSYGCEYKFFTEFQSHELEFDYLKSLEIEEKINAIEWFDDTGRNHFLLSTN 107 (460)
T ss_pred eeeEEEeccccceEeecCCCceEEEeecccccccchhhhhhhcccccchhhhhhccHHHHhhheeeecCCCcceEEEecC
Confidence 35899999999999999999999999965443 222 122233443100 0001236667655 444 46777789
Q ss_pred CCcEEEeeCCCC-------------------Cc------------c------Ccccceee-eecCCCeeEEEEecCCCCE
Q 000080 2292 DGTVCTWQLEVG-------------------GR------------S------NVRPMESC-LCFSSHAMDVSYITSSGSV 2333 (2389)
Q Consensus 2292 DgTVkLWDl~tg-------------------gr------------s------~~k~l~tl-~gHs~~V~sVAFSP~DGsl 2333 (2389)
|.|||||-+... |. + ..+|-+-. ..|..+++++.|+. |.+.
T Consensus 108 dktiKlWKiyeknlk~va~nnls~~~~~~~~g~~~s~~~l~lprls~hd~iiaa~p~rvyaNaH~yhiNSiS~Ns-D~et 186 (460)
T COG5170 108 DKTIKLWKIYEKNLKVVAENNLSDSFHSPMGGPLTSTKELLLPRLSEHDEIIAAKPCRVYANAHPYHINSISFNS-DKET 186 (460)
T ss_pred CceeeeeeeecccchhhhccccccccccccCCCcCCHHHhhcccccccceEEEeccceeccccceeEeeeeeecC-chhe
Confidence 999999977532 00 0 00011111 45889999999999 8888
Q ss_pred EEEeecCCCCCeEEEeeCC
Q 000080 2334 IAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2334 LASAG~sS~D~TVrLWD~l 2352 (2389)
+.|| +|=.|-||++-
T Consensus 187 ~lSa----DdLrINLWnl~ 201 (460)
T COG5170 187 LLSA----DDLRINLWNLE 201 (460)
T ss_pred eeec----cceeeeecccc
Confidence 8884 88899999974
No 327
>PRK13616 lipoprotein LpqB; Provisional
Probab=87.27 E-value=2.5 Score=56.58 Aligned_cols=102 Identities=9% Similarity=-0.029 Sum_probs=63.0
Q ss_pred eEEEEEEcCCCCeEEEEe------CCC--cEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC
Q 000080 2221 STRAFSSHPLRPFFLVGS------SNT--HIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD 2292 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS------~Dg--TIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D 2292 (2389)
.+.+.+++|||+.+|.-- .|. +|.+++.+ |.. +.+. . | ...+.-.|+|||+.+++.+..
T Consensus 351 ~vsspaiSpdG~~vA~v~~~~~~~~d~~s~Lwv~~~g-g~~-~~lt--~-------g--~~~t~PsWspDG~~lw~v~dg 417 (591)
T PRK13616 351 NITSAALSRSGRQVAAVVTLGRGAPDPASSLWVGPLG-GVA-VQVL--E-------G--HSLTRPSWSLDADAVWVVVDG 417 (591)
T ss_pred CcccceECCCCCEEEEEEeecCCCCCcceEEEEEeCC-Ccc-eeee--c-------C--CCCCCceECCCCCceEEEecC
Confidence 347889999999877655 344 45555542 322 2221 1 1 236788999999988888643
Q ss_pred ----------CcEEEe--eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEE
Q 000080 2293 ----------GTVCTW--QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVV 2348 (2389)
Q Consensus 2293 ----------gTVkLW--Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrL 2348 (2389)
++=.+| ++..+. . .. ...+.|.++++|| ||.+||.. .++.|.|
T Consensus 418 ~~~~~v~~~~~~gql~~~~vd~ge-----~-~~--~~~g~Issl~wSp-DG~RiA~i----~~g~v~V 472 (591)
T PRK13616 418 NTVVRVIRDPATGQLARTPVDASA-----V-AS--RVPGPISELQLSR-DGVRAAMI----IGGKVYL 472 (591)
T ss_pred cceEEEeccCCCceEEEEeccCch-----h-hh--ccCCCcCeEEECC-CCCEEEEE----ECCEEEE
Confidence 222344 444321 1 11 2356799999999 99999975 2455655
No 328
>KOG3617 consensus WD40 and TPR repeat-containing protein [General function prediction only]
Probab=86.98 E-value=0.78 Score=61.25 Aligned_cols=81 Identities=20% Similarity=0.249 Sum_probs=64.9
Q ss_pred cCCCCcCc-eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe
Q 000080 2212 DPPATVEN-ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA 2290 (2389)
Q Consensus 2212 d~~atv~n-i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS 2290 (2389)
+|.+.+.+ +++.+++|||..-.|++|=.-|.+.+|..++. ...|.- .-|...+.-+.|||||+.+.|+.
T Consensus 51 EPqr~Vt~P~hatSLCWHpe~~vLa~gwe~g~~~v~~~~~~-e~htv~---------~th~a~i~~l~wS~~G~~l~t~d 120 (1416)
T KOG3617|consen 51 EPQRDVTYPVHATSLCWHPEEFVLAQGWEMGVSDVQKTNTT-ETHTVV---------ETHPAPIQGLDWSHDGTVLMTLD 120 (1416)
T ss_pred CCCcccccceehhhhccChHHHHHhhccccceeEEEecCCc-eeeeec---------cCCCCCceeEEecCCCCeEEEcC
Confidence 35556665 67788999999999999999999999997543 344431 12568899999999999999999
Q ss_pred CCCcEEEeeCCC
Q 000080 2291 LDGTVCTWQLEV 2302 (2389)
Q Consensus 2291 ~DgTVkLWDl~t 2302 (2389)
.=|.|.+|....
T Consensus 121 ~~g~v~lwr~d~ 132 (1416)
T KOG3617|consen 121 NPGSVHLWRYDV 132 (1416)
T ss_pred CCceeEEEEeee
Confidence 999999996653
No 329
>PF10647 Gmad1: Lipoprotein LpqB beta-propeller domain; InterPro: IPR018910 The Gmad1 domain is found associated with IPR019606 from INTERPRO, in bacterial spore formation. It is predicted to have a beta-propeller fold and to have a passive binding role rather than a catalytic function owing to the low number of conserved hydrophilic residues.
Probab=86.54 E-value=6.8 Score=47.09 Aligned_cols=113 Identities=14% Similarity=0.110 Sum_probs=71.5
Q ss_pred EEEEEEcCCCCeEEEEe---CCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080 2222 TRAFSSHPLRPFFLVGS---SNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus 2222 VrsVAFsPdG~~LASGS---~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
+.+.+.+|||+.+|.-. ....++.+.. +....... .+ ..+..-.|+++|...+....+...+++
T Consensus 26 ~~s~AvS~dg~~~A~v~~~~~~~~L~~~~~--~~~~~~~~--~g---------~~l~~PS~d~~g~~W~v~~~~~~~~~~ 92 (253)
T PF10647_consen 26 VTSPAVSPDGSRVAAVSEGDGGRSLYVGPA--GGPVRPVL--TG---------GSLTRPSWDPDGWVWTVDDGSGGVRVV 92 (253)
T ss_pred ccceEECCCCCeEEEEEEcCCCCEEEEEcC--CCcceeec--cC---------CccccccccCCCCEEEEEcCCCceEEE
Confidence 47779999999777655 4444555544 43333321 11 357888999999999998989999998
Q ss_pred e-CCCCCccCcccce-eeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2299 Q-LEVGGRSNVRPME-SCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2299 D-l~tggrs~~k~l~-tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
. ..+++. .+.. ....-...|.++++|| ||.++|-.-....++.|.+=-+
T Consensus 93 ~~~~~g~~---~~~~v~~~~~~~~I~~l~vSp-DG~RvA~v~~~~~~~~v~va~V 143 (253)
T PF10647_consen 93 RDSASGTG---EPVEVDWPGLRGRITALRVSP-DGTRVAVVVEDGGGGRVYVAGV 143 (253)
T ss_pred EecCCCcc---eeEEecccccCCceEEEEECC-CCcEEEEEEecCCCCeEEEEEE
Confidence 5 333321 1111 1111112899999999 9999987532234566666554
No 330
>PRK13616 lipoprotein LpqB; Provisional
Probab=86.41 E-value=4 Score=54.75 Aligned_cols=144 Identities=17% Similarity=0.057 Sum_probs=72.7
Q ss_pred EEEEEcCCCCeEEEEeCC-CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEE---e
Q 000080 2223 RAFSSHPLRPFFLVGSSN-THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCT---W 2298 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~D-gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkL---W 2298 (2389)
.+-+|+|||..|++.++. ..+++.+-.....+....+ .+..... .....|.++++||||+++|... +|.|.+ =
T Consensus 400 t~PsWspDG~~lw~v~dg~~~~~v~~~~~~gql~~~~v-d~ge~~~-~~~g~Issl~wSpDG~RiA~i~-~g~v~Va~Vv 476 (591)
T PRK13616 400 TRPSWSLDADAVWVVVDGNTVVRVIRDPATGQLARTPV-DASAVAS-RVPGPISELQLSRDGVRAAMII-GGKVYLAVVE 476 (591)
T ss_pred CCceECCCCCceEEEecCcceEEEeccCCCceEEEEec-cCchhhh-ccCCCcCeEEECCCCCEEEEEE-CCEEEEEEEE
Confidence 344899999988887654 2344444321112221111 1110000 0124699999999999999887 466665 2
Q ss_pred eCCCCCccCcccceeee-ecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEe--ecCcEEEEeec
Q 000080 2299 QLEVGGRSNVRPMESCL-CFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITC--HEGLYDLFLPL 2375 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~tl~-gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~G--H~~~V~svA~~ 2375 (2389)
....|.. .+.....+. +-...+.+++|.+ +++++ .+. .+....+|.+.. .|.....+.+ ...++..||-.
T Consensus 477 r~~~G~~-~l~~~~~l~~~l~~~~~~l~W~~-~~~L~-V~~---~~~~~~v~~v~v-DG~~~~~~~~~n~~~~v~~vaa~ 549 (591)
T PRK13616 477 QTEDGQY-ALTNPREVGPGLGDTAVSLDWRT-GDSLV-VGR---SDPEHPVWYVNL-DGSNSDALPSRNLSAPVVAVAAS 549 (591)
T ss_pred eCCCCce-eecccEEeecccCCccccceEec-CCEEE-EEe---cCCCCceEEEec-CCccccccCCCCccCceEEEecC
Confidence 3222211 011112222 2233467899998 77765 432 334455677521 2222122222 25556666655
Q ss_pred c
Q 000080 2376 K 2376 (2389)
Q Consensus 2376 ~ 2376 (2389)
+
T Consensus 550 ~ 550 (591)
T PRK13616 550 P 550 (591)
T ss_pred C
Confidence 4
No 331
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=86.00 E-value=4.3 Score=50.42 Aligned_cols=98 Identities=8% Similarity=0.017 Sum_probs=62.1
Q ss_pred CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcc
Q 000080 2230 LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVR 2309 (2389)
Q Consensus 2230 dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k 2309 (2389)
++..+..++.||.|..+|..+|+.+-.+..+.+ ..+.+... .|..+..++.||.|.++|..+|+
T Consensus 278 ~~~~vyv~~~~G~l~~~d~~tG~~~W~~~~~~~---------~~~ssp~i--~g~~l~~~~~~G~l~~~d~~tG~----- 341 (377)
T TIGR03300 278 DDNRLYVTDADGVVVALDRRSGSELWKNDELKY---------RQLTAPAV--VGGYLVVGDFEGYLHWLSREDGS----- 341 (377)
T ss_pred eCCEEEEECCCCeEEEEECCCCcEEEccccccC---------CccccCEE--ECCEEEEEeCCCEEEEEECCCCC-----
Confidence 466777788999999999999987755421111 11122122 47799999999999999999873
Q ss_pred cceeeeecCCCee-EEEEecCCCCEEEEeecCCCCCeEEEe
Q 000080 2310 PMESCLCFSSHAM-DVSYITSSGSVIAAAGHSSNGINVVVW 2349 (2389)
Q Consensus 2310 ~l~tl~gHs~~V~-sVAFSP~DGslLASAG~sS~D~TVrLW 2349 (2389)
.+.++.-+...+. +-++. ++++++. +.|++|..+
T Consensus 342 ~~~~~~~~~~~~~~sp~~~--~~~l~v~----~~dG~l~~~ 376 (377)
T TIGR03300 342 FVARLKTDGSGIASPPVVV--GDGLLVQ----TRDGDLYAF 376 (377)
T ss_pred EEEEEEcCCCccccCCEEE--CCEEEEE----eCCceEEEe
Confidence 4445544443332 22333 4455543 378877654
No 332
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=84.99 E-value=8.9 Score=43.81 Aligned_cols=141 Identities=17% Similarity=0.113 Sum_probs=80.8
Q ss_pred ccccccccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEE
Q 000080 2199 LGWETQDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQ 2278 (2389)
Q Consensus 2199 ~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVa 2278 (2389)
+.-.+.+.+|.+.- ....... .. ...+++..+.+++.++.|+.||..+|+.+-.+.. ++. .+..
T Consensus 8 ~d~~tG~~~W~~~~-~~~~~~~--~~-~~~~~~~~v~~~~~~~~l~~~d~~tG~~~W~~~~-~~~-----~~~~------ 71 (238)
T PF13360_consen 8 LDPRTGKELWSYDL-GPGIGGP--VA-TAVPDGGRVYVASGDGNLYALDAKTGKVLWRFDL-PGP-----ISGA------ 71 (238)
T ss_dssp EETTTTEEEEEEEC-SSSCSSE--EE-TEEEETTEEEEEETTSEEEEEETTTSEEEEEEEC-SSC-----GGSG------
T ss_pred EECCCCCEEEEEEC-CCCCCCc--cc-eEEEeCCEEEEEcCCCEEEEEECCCCCEEEEeec-ccc-----ccce------
Confidence 35556677776621 1112222 11 1333566677779999999999999998877642 221 0111
Q ss_pred ECCCCCEEEEEeCCCcEEEeeCCCCCccCccccee-eeecC---CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCC
Q 000080 2279 FDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMES-CLCFS---SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAP 2354 (2389)
Q Consensus 2279 FSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~t-l~gHs---~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~ 2354 (2389)
...++..+..++.|+.|..+|.++|. .+.. ..... ......+... +|..++.+ ..++.|...|. .
T Consensus 72 ~~~~~~~v~v~~~~~~l~~~d~~tG~-----~~W~~~~~~~~~~~~~~~~~~~~-~~~~~~~~---~~~g~l~~~d~--~ 140 (238)
T PF13360_consen 72 PVVDGGRVYVGTSDGSLYALDAKTGK-----VLWSIYLTSSPPAGVRSSSSPAV-DGDRLYVG---TSSGKLVALDP--K 140 (238)
T ss_dssp EEEETTEEEEEETTSEEEEEETTTSC-----EEEEEEE-SSCTCSTB--SEEEE-ETTEEEEE---ETCSEEEEEET--T
T ss_pred eeecccccccccceeeeEecccCCcc-----eeeeeccccccccccccccCceE-ecCEEEEE---eccCcEEEEec--C
Confidence 23456677777788999999999973 3333 12111 1112222333 34555544 25788999996 4
Q ss_pred CCCceEEEEeec
Q 000080 2355 PTSSRASITCHE 2366 (2389)
Q Consensus 2355 tg~~v~sL~GH~ 2366 (2389)
+|+.+.....+.
T Consensus 141 tG~~~w~~~~~~ 152 (238)
T PF13360_consen 141 TGKLLWKYPVGE 152 (238)
T ss_dssp TTEEEEEEESST
T ss_pred CCcEEEEeecCC
Confidence 666666665544
No 333
>KOG1832 consensus HIV-1 Vpr-binding protein [Cell cycle control, cell division, chromosome partitioning]
Probab=84.93 E-value=0.7 Score=61.94 Aligned_cols=135 Identities=13% Similarity=0.105 Sum_probs=88.0
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-CC-cEEEeeC
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-DG-TVCTWQL 2300 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-Dg-TVkLWDl 2300 (2389)
..++|+-+-+.|+.|+..|.|+++++.+|.....+. +|.+.|+-|.-|-||.+..+.|. .. -..||++
T Consensus 1105 Tc~afs~~~~hL~vG~~~Geik~~nv~sG~~e~s~n----------cH~SavT~vePs~dgs~~Ltsss~S~PlsaLW~~ 1174 (1516)
T KOG1832|consen 1105 TCIAFSGGTNHLAVGSHAGEIKIFNVSSGSMEESVN----------CHQSAVTLVEPSVDGSTQLTSSSSSSPLSALWDA 1174 (1516)
T ss_pred eeEEeecCCceEEeeeccceEEEEEccCcccccccc----------ccccccccccccCCcceeeeeccccCchHHHhcc
Confidence 678999999999999999999999999998665542 46688999999999976655443 33 5789999
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEE-EEeec---CcEEEEeecc
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRAS-ITCHE---GLYDLFLPLK 2376 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~s-L~GH~---~~V~svA~~~ 2376 (2389)
...+ .+..++. .-..|-|+. .-+.=| -|. ....+-|+|+ +++..+++ |.+-. -.-++..|+|
T Consensus 1175 ~s~~----~~~Hsf~----ed~~vkFsn-~~q~r~-~gt--~~d~a~~YDv--qT~~~l~tylt~~~~~~y~~n~a~FsP 1240 (1516)
T KOG1832|consen 1175 SSTG----GPRHSFD----EDKAVKFSN-SLQFRA-LGT--EADDALLYDV--QTCSPLQTYLTDTVTSSYSNNLAHFSP 1240 (1516)
T ss_pred cccc----Ccccccc----ccceeehhh-hHHHHH-hcc--cccceEEEec--ccCcHHHHhcCcchhhhhhccccccCC
Confidence 7643 3433332 233577886 322222 232 3345789998 55554555 33211 1113555666
Q ss_pred cchhh
Q 000080 2377 LLNFA 2381 (2389)
Q Consensus 2377 ~~~~~ 2381 (2389)
.-.-+
T Consensus 1241 ~D~LI 1245 (1516)
T KOG1832|consen 1241 CDTLI 1245 (1516)
T ss_pred CcceE
Confidence 54443
No 334
>KOG2444 consensus WD40 repeat protein [General function prediction only]
Probab=84.40 E-value=2.4 Score=50.63 Aligned_cols=105 Identities=11% Similarity=0.129 Sum_probs=64.6
Q ss_pred CeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccc
Q 000080 2232 PFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPM 2311 (2389)
Q Consensus 2232 ~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l 2311 (2389)
.-++.|+.||.|++|++.---...... ..+-..-+..|.---++...-+++.||.||.|++.-.. .+
T Consensus 71 ~~~~vG~~dg~v~~~n~n~~g~~~d~~--------~s~~e~i~~~Ip~~~~~~~~c~~~~dg~ir~~n~~p~k-----~~ 137 (238)
T KOG2444|consen 71 AKLMVGTSDGAVYVFNWNLEGAHSDRV--------CSGEESIDLGIPNGRDSSLGCVGAQDGRIRACNIKPNK-----VL 137 (238)
T ss_pred ceEEeecccceEEEecCCccchHHHhh--------hcccccceeccccccccceeEEeccCCceeeeccccCc-----ee
Confidence 457889999999999986111111100 01112234445555677789999999999999997642 22
Q ss_pred eeeeecC-CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2312 ESCLCFS-SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2312 ~tl~gHs-~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
...-.|+ -.+.....+. +++.|+.+- -|.|++++.|++
T Consensus 138 g~~g~h~~~~~e~~ivv~-sd~~i~~a~-~S~d~~~k~W~v 176 (238)
T KOG2444|consen 138 GYVGQHNFESGEELIVVG-SDEFLKIAD-TSHDRVLKKWNV 176 (238)
T ss_pred eeeccccCCCcceeEEec-CCceEEeec-cccchhhhhcch
Confidence 2223344 3444555555 667777652 246778888886
No 335
>PF02897 Peptidase_S9_N: Prolyl oligopeptidase, N-terminal beta-propeller domain; InterPro: IPR004106 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This entry represents the beta-propeller domain found at the N-terminal of prolyl oligopeptidase, including acylamino-acid-releasing enzyme (also known as acylaminoacyl peptidase), which belong to the MEROPS peptidase family S9 (clan SC), subfamily S9A. The prolyl oligopeptidase family consist of a number of evolutionary related peptidases whose catalytic activity seems to be provided by a charge relay system similar to that of the trypsin family of serine proteases, but which evolved by independent convergent evolution. The N-terminal domain of prolyl oligopeptidases form an unusual 7-bladed beta-propeller consisting of seven 4-stranded beta-sheet motifs. Prolyl oligopeptidase is a large cytosolic enzyme involved in the maturation and degradation of peptide hormones and neuropeptides, which relate to the induction of amnesia. The enzyme contains a peptidase domain, where its catalytic triad (Ser554, His680, Asp641) is covered by the central tunnel of the N-terminal beta-propeller domain. In this way, large structured peptides are excluded from the active site, thereby protecting larger peptides and proteins from proteolysis in the cytosol []. The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. Mammalian acylaminoacyl peptidase is an exopeptidase that is a member of the same prolyl oligopeptidase family of serine peptidases. This enzyme removes acylated amino acid residues from the N terminus of oligopeptides [].; GO: 0004252 serine-type endopeptidase activity, 0006508 proteolysis; PDB: 2BKL_B 3DDU_A 1YR2_A 2XE4_A 1VZ3_A 3EQ9_A 1O6F_A 3EQ7_A 4AN0_A 1UOP_A ....
Probab=82.95 E-value=7.1 Score=49.21 Aligned_cols=102 Identities=14% Similarity=0.088 Sum_probs=61.7
Q ss_pred CEEEEEECCCCCEEEEE-eCC----CcEEEeeCCCCCccCcccce-eeeecCCCeeEEEEecCCCCEEEEeecCCC----
Q 000080 2273 SISALQFDHYGHRFASA-ALD----GTVCTWQLEVGGRSNVRPME-SCLCFSSHAMDVSYITSSGSVIAAAGHSSN---- 2342 (2389)
Q Consensus 2273 ~V~sVaFSPDG~~LASg-S~D----gTVkLWDl~tggrs~~k~l~-tl~gHs~~V~sVAFSP~DGslLASAG~sS~---- 2342 (2389)
.+...++||||+++|-+ +.. .+|++.|+++|. .+. .+.. .. ...++|.+ ||+.+.-..+...
T Consensus 125 ~~~~~~~Spdg~~la~~~s~~G~e~~~l~v~Dl~tg~-----~l~d~i~~-~~-~~~~~W~~-d~~~~~y~~~~~~~~~~ 196 (414)
T PF02897_consen 125 SLGGFSVSPDGKRLAYSLSDGGSEWYTLRVFDLETGK-----FLPDGIEN-PK-FSSVSWSD-DGKGFFYTRFDEDQRTS 196 (414)
T ss_dssp EEEEEEETTTSSEEEEEEEETTSSEEEEEEEETTTTE-----EEEEEEEE-EE-SEEEEECT-TSSEEEEEECSTTTSS-
T ss_pred EeeeeeECCCCCEEEEEecCCCCceEEEEEEECCCCc-----CcCCcccc-cc-cceEEEeC-CCCEEEEEEeCcccccc
Confidence 34568999999999854 333 459999999972 222 1111 11 12399999 7777655444332
Q ss_pred ----CCeEEEeeCCCCCCCceEEEEeecCc--EEEEeecccchhhh
Q 000080 2343 ----GINVVVWDTLAPPTSSRASITCHEGL--YDLFLPLKLLNFAL 2382 (2389)
Q Consensus 2343 ----D~TVrLWD~l~~tg~~v~sL~GH~~~--V~svA~~~~~~~~~ 2382 (2389)
...|+.|++-.+..+..-.+++..+. ...+..+++|+|++
T Consensus 197 ~~~~~~~v~~~~~gt~~~~d~lvfe~~~~~~~~~~~~~s~d~~~l~ 242 (414)
T PF02897_consen 197 DSGYPRQVYRHKLGTPQSEDELVFEEPDEPFWFVSVSRSKDGRYLF 242 (414)
T ss_dssp CCGCCEEEEEEETTS-GGG-EEEEC-TTCTTSEEEEEE-TTSSEEE
T ss_pred cCCCCcEEEEEECCCChHhCeeEEeecCCCcEEEEEEecCcccEEE
Confidence 44588888732222223455555544 45888999999876
No 336
>KOG3621 consensus WD40 repeat-containing protein [General function prediction only]
Probab=82.93 E-value=8.8 Score=51.59 Aligned_cols=140 Identities=14% Similarity=0.122 Sum_probs=95.6
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.|.--++..++.+|+-|++-|.++|++-..|+. +.+.. . |..+.+.....|++....|.|+..|.|.+.++
T Consensus 35 ~v~lTc~dst~~~l~~GsS~G~lyl~~R~~~~~-~~~~~-~-------~~~~~~~~~~vs~~e~lvAagt~~g~V~v~ql 105 (726)
T KOG3621|consen 35 RVKLTCVDATEEYLAMGSSAGSVYLYNRHTGEM-RKLKN-E-------GATGITCVRSVSSVEYLVAAGTASGRVSVFQL 105 (726)
T ss_pred eEEEEEeecCCceEEEecccceEEEEecCchhh-hcccc-c-------CccceEEEEEecchhHhhhhhcCCceEEeehh
Confidence 445557888999999999999999999765553 33321 1 12255677888999999999999999999999
Q ss_pred CCCCccCcccc-ee--e-eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCC-CCCCc-eEEEEeecCcEEEEee
Q 000080 2301 EVGGRSNVRPM-ES--C-LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLA-PPTSS-RASITCHEGLYDLFLP 2374 (2389)
Q Consensus 2301 ~tggrs~~k~l-~t--l-~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~-~tg~~-v~sL~GH~~~V~svA~ 2374 (2389)
+.+. +.+. +. . .-|...|++++|++ ||..+-+| -.-|+|.+=.+.. .-..+ +|.+..-...|.-+..
T Consensus 106 ~~~~---p~~~~~~t~~d~~~~~rVTal~Ws~-~~~k~ysG---D~~Gkv~~~~L~s~~~~~~~~q~il~~ds~IVQlD~ 178 (726)
T KOG3621|consen 106 NKEL---PRDLDYVTPCDKSHKCRVTALEWSK-NGMKLYSG---DSQGKVVLTELDSRQAFLSKSQEILSEDSEIVQLDY 178 (726)
T ss_pred hccC---CCcceeeccccccCCceEEEEEecc-cccEEeec---CCCceEEEEEechhhhhccccceeeccCcceEEeec
Confidence 8742 1111 11 1 12678899999999 99999985 2456777666532 11122 4555555666666655
Q ss_pred cc
Q 000080 2375 LK 2376 (2389)
Q Consensus 2375 ~~ 2376 (2389)
..
T Consensus 179 ~q 180 (726)
T KOG3621|consen 179 LQ 180 (726)
T ss_pred cc
Confidence 44
No 337
>COG0823 TolB Periplasmic component of the Tol biopolymer transport system [Intracellular trafficking and secretion]
Probab=82.69 E-value=6.8 Score=50.75 Aligned_cols=139 Identities=15% Similarity=0.177 Sum_probs=74.8
Q ss_pred cceeecCCCCCCeEEEEecCC--cEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEEe--cC
Q 000080 42 STIDWLPDFAGYSWVAYGASS--LLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAAA--SE 117 (2389)
Q Consensus 42 ~ai~wlpD~~G~~~vAYasg~--~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaAS--yD 117 (2389)
....|+||...+..+.+..+. .+++..+..+... .+ ..++++ .-.-+|||| +..||-+ -|
T Consensus 196 ~~p~ws~~~~~~~y~~f~~~~~~~i~~~~l~~g~~~--~i------~~~~g~-----~~~P~fspD---G~~l~f~~~rd 259 (425)
T COG0823 196 LTPAWSPDGKKLAYVSFELGGCPRIYYLDLNTGKRP--VI------LNFNGN-----NGAPAFSPD---GSKLAFSSSRD 259 (425)
T ss_pred eccccCcCCCceEEEEEecCCCceEEEEeccCCccc--ee------eccCCc-----cCCccCCCC---CCEEEEEECCC
Confidence 346789983333233333444 3555544332211 11 113343 335689999 6666633 46
Q ss_pred CeEEEEeeCCCCCCCCccceeeEEecc-cceEEEEeecCCCCeEEEEecc---eEEeec--cCCcEEEEEEeeccccceE
Q 000080 118 NCIFVFAHDSASSKGSFCWSQNAILVQ-GTKVEAIEWTGSGDGIVAGGME---TVLWKK--KNTLWEIAWKFKENYPQNL 191 (2389)
Q Consensus 118 ntIRVw~~d~~~~kgd~~W~~~~tL~h-ssTV~sIAWSpdG~rLaSggdD---V~IW~~--~~s~Wecvwt~~~~~~~~i 191 (2389)
+...||--|- .... ...|++ .+.=..=+|+|||++|+-.+|. -+||.. ..+.=+.+. ..+....
T Consensus 260 g~~~iy~~dl--~~~~-----~~~Lt~~~gi~~~Ps~spdG~~ivf~Sdr~G~p~I~~~~~~g~~~~riT-~~~~~~~-- 329 (425)
T COG0823 260 GSPDIYLMDL--DGKN-----LPRLTNGFGINTSPSWSPDGSKIVFTSDRGGRPQIYLYDLEGSQVTRLT-FSGGGNS-- 329 (425)
T ss_pred CCccEEEEcC--CCCc-----ceecccCCccccCccCCCCCCEEEEEeCCCCCcceEEECCCCCceeEee-ccCCCCc--
Confidence 8888887761 1111 111443 2222367899999999988885 556653 222223331 2222211
Q ss_pred EEEeecCCCc-eEeeec
Q 000080 192 VSATWSIEGP-SATAAS 207 (2389)
Q Consensus 192 vsvaWSpdG~-fATag~ 207 (2389)
.-.|||||. +|-++.
T Consensus 330 -~p~~SpdG~~i~~~~~ 345 (425)
T COG0823 330 -NPVWSPDGDKIVFESS 345 (425)
T ss_pred -CccCCCCCCEEEEEec
Confidence 348999999 777763
No 338
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=82.47 E-value=7 Score=44.65 Aligned_cols=102 Identities=14% Similarity=0.065 Sum_probs=61.8
Q ss_pred CCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecC
Q 000080 2239 SNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFS 2318 (2389)
Q Consensus 2239 ~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs 2318 (2389)
+||+|+.||..+|+.+-.+.. .. +. ...... ..++++.+.+++.++.|..||..+|. .+.+... .
T Consensus 1 ~~g~l~~~d~~tG~~~W~~~~-~~------~~-~~~~~~-~~~~~~~v~~~~~~~~l~~~d~~tG~-----~~W~~~~-~ 65 (238)
T PF13360_consen 1 DDGTLSALDPRTGKELWSYDL-GP------GI-GGPVAT-AVPDGGRVYVASGDGNLYALDAKTGK-----VLWRFDL-P 65 (238)
T ss_dssp -TSEEEEEETTTTEEEEEEEC-SS------SC-SSEEET-EEEETTEEEEEETTSEEEEEETTTSE-----EEEEEEC-S
T ss_pred CCCEEEEEECCCCCEEEEEEC-CC------CC-CCccce-EEEeCCEEEEEcCCCEEEEEECCCCC-----EEEEeec-c
Confidence 589999999999999877641 10 01 112211 44466677777999999999999972 3333332 2
Q ss_pred CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEE
Q 000080 2319 SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASI 2362 (2389)
Q Consensus 2319 ~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL 2362 (2389)
..+....... ++.+++. +.|+.|..+|+ .+|+.+...
T Consensus 66 ~~~~~~~~~~-~~~v~v~----~~~~~l~~~d~--~tG~~~W~~ 102 (238)
T PF13360_consen 66 GPISGAPVVD-GGRVYVG----TSDGSLYALDA--KTGKVLWSI 102 (238)
T ss_dssp SCGGSGEEEE-TTEEEEE----ETTSEEEEEET--TTSCEEEEE
T ss_pred ccccceeeec-ccccccc----cceeeeEeccc--CCcceeeee
Confidence 2211111222 4455443 25678999996 577777663
No 339
>COG3391 Uncharacterized conserved protein [Function unknown]
Probab=82.22 E-value=27 Score=44.46 Aligned_cols=140 Identities=15% Similarity=0.116 Sum_probs=86.5
Q ss_pred EEEEEcCCCCe-EEEEe--CCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEE-eCCCcEEEe
Q 000080 2223 RAFSSHPLRPF-FLVGS--SNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASA-ALDGTVCTW 2298 (2389)
Q Consensus 2223 rsVAFsPdG~~-LASGS--~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASg-S~DgTVkLW 2298 (2389)
..++++|+++. .++-+ .+++|.+-|-.+++.+.+.. . |- .. ..++|+|+|+++..+ +.+++|.+-
T Consensus 119 ~~~~~~~~~~~vYV~n~~~~~~~vsvid~~t~~~~~~~~---v------G~-~P-~~~a~~p~g~~vyv~~~~~~~v~vi 187 (381)
T COG3391 119 VGLAVDPDGKYVYVANAGNGNNTVSVIDAATNKVTATIP---V------GN-TP-TGVAVDPDGNKVYVTNSDDNTVSVI 187 (381)
T ss_pred ceEEECCCCCEEEEEecccCCceEEEEeCCCCeEEEEEe---c------CC-Cc-ceEEECCCCCeEEEEecCCCeEEEE
Confidence 56799999964 44444 37999999988888877742 1 11 22 889999999855554 589999999
Q ss_pred eCCCCCccCcccce-----eeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEE-EEeecCcEEEE
Q 000080 2299 QLEVGGRSNVRPME-----SCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRAS-ITCHEGLYDLF 2372 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~-----tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~s-L~GH~~~V~sv 2372 (2389)
|.++.. ..+ ...-+ ..-..+++.| ||+.+-.+-..+.|++|-.=|+ .++..... +..-.++-..+
T Consensus 188 ~~~~~~-----v~~~~~~~~~~~~-~~P~~i~v~~-~g~~~yV~~~~~~~~~v~~id~--~~~~v~~~~~~~~~~~~~~v 258 (381)
T COG3391 188 DTSGNS-----VVRGSVGSLVGVG-TGPAGIAVDP-DGNRVYVANDGSGSNNVLKIDT--ATGNVTATDLPVGSGAPRGV 258 (381)
T ss_pred eCCCcc-----eeccccccccccC-CCCceEEECC-CCCEEEEEeccCCCceEEEEeC--CCceEEEeccccccCCCCce
Confidence 976531 111 11112 2335688999 8884443322334467888886 23333222 22112134467
Q ss_pred eecccchhhh
Q 000080 2373 LPLKLLNFAL 2382 (2389)
Q Consensus 2373 A~~~~~~~~~ 2382 (2389)
+..|+|.++-
T Consensus 259 ~~~p~g~~~y 268 (381)
T COG3391 259 AVDPAGKAAY 268 (381)
T ss_pred eECCCCCEEE
Confidence 8888887763
No 340
>PRK02888 nitrous-oxide reductase; Validated
Probab=81.03 E-value=11 Score=50.93 Aligned_cols=56 Identities=14% Similarity=0.114 Sum_probs=37.5
Q ss_pred CCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2292 DGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2292 DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
+++|.+.|.++..+.. ..+...-.=......|+++| ||+++..+| -.+.+|-|-|+
T Consensus 295 gn~V~VID~~t~~~~~-~~v~~yIPVGKsPHGV~vSP-DGkylyVan--klS~tVSVIDv 350 (635)
T PRK02888 295 GSKVPVVDGRKAANAG-SALTRYVPVPKNPHGVNTSP-DGKYFIANG--KLSPTVTVIDV 350 (635)
T ss_pred CCEEEEEECCccccCC-cceEEEEECCCCccceEECC-CCCEEEEeC--CCCCcEEEEEC
Confidence 4679999988710000 11222222345567799999 999988876 57889999998
No 341
>PF12234 Rav1p_C: RAVE protein 1 C terminal; InterPro: IPR022033 This domain family is found in eukaryotes, and is typically between 621 and 644 amino acids in length. This family is the C-terminal region of the protein RAVE (regulator of the ATPase of vacuolar and endosomal membranes). Rav1p is involved in regulating the glucose dependent assembly and disassembly of vacuolar ATPase V1 and V0 subunits.
Probab=80.54 E-value=9.5 Score=51.54 Aligned_cols=25 Identities=8% Similarity=-0.015 Sum_probs=14.9
Q ss_pred CChhHHHHHHHHhCC-hhHHHHHHhc
Q 000080 1386 GDYWLTSLLEWELGN-YSQSFLTMLG 1410 (2389)
Q Consensus 1386 gDrwL~S~a~W~L~~-~~~Av~~Ll~ 1410 (2389)
..||.-..+|.+|++ ...||+++++
T Consensus 465 k~Ry~~AAaFFLLag~l~dAv~V~~~ 490 (631)
T PF12234_consen 465 KHRYEYAAAFFLLAGSLKDAVNVCLR 490 (631)
T ss_pred cccHHHHHHHHHhcccHHHHHHHHHH
Confidence 456666666666654 5566666663
No 342
>PRK10115 protease 2; Provisional
Probab=80.20 E-value=35 Score=46.89 Aligned_cols=117 Identities=9% Similarity=-0.002 Sum_probs=70.9
Q ss_pred eeEEEEEEcCCCCeEEE-----EeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC--
Q 000080 2220 ISTRAFSSHPLRPFFLV-----GSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD-- 2292 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LAS-----GS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D-- 2292 (2389)
..+..+.++|||++||- |++..+|++-|+.+|+.+.+. + . +.-..++|++||+.|.-+..|
T Consensus 127 ~~l~~~~~Spdg~~la~~~d~~G~E~~~l~v~d~~tg~~l~~~--i-------~---~~~~~~~w~~D~~~~~y~~~~~~ 194 (686)
T PRK10115 127 YTLGGMAITPDNTIMALAEDFLSRRQYGIRFRNLETGNWYPEL--L-------D---NVEPSFVWANDSWTFYYVRKHPV 194 (686)
T ss_pred EEEeEEEECCCCCEEEEEecCCCcEEEEEEEEECCCCCCCCcc--c-------c---CcceEEEEeeCCCEEEEEEecCC
Confidence 45577899999998775 445567899999888643321 1 0 111569999999877766553
Q ss_pred ----CcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2293 ----GTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2293 ----gTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
..|.+|++.++. +....+.. +......-..+.+.||+.+.....+..++.+.+++.
T Consensus 195 ~~~~~~v~~h~lgt~~-~~d~lv~~--e~~~~~~~~~~~s~d~~~l~i~~~~~~~~~~~l~~~ 254 (686)
T PRK10115 195 TLLPYQVWRHTIGTPA-SQDELVYE--EKDDTFYVSLHKTTSKHYVVIHLASATTSEVLLLDA 254 (686)
T ss_pred CCCCCEEEEEECCCCh-hHCeEEEe--eCCCCEEEEEEEcCCCCEEEEEEECCccccEEEEEC
Confidence 357778888762 11122322 222222312233337776655544556778999995
No 343
>KOG1275 consensus PAB-dependent poly(A) ribonuclease, subunit PAN2 [Replication, recombination and repair]
Probab=80.16 E-value=5.2 Score=54.76 Aligned_cols=102 Identities=16% Similarity=0.178 Sum_probs=79.5
Q ss_pred CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcc
Q 000080 2230 LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVR 2309 (2389)
Q Consensus 2230 dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k 2309 (2389)
++..++-|+.-..+--.|+.+++..++..+ . .+.|.-+ -.+++.|-+|+.-|+|-|=|.++- +
T Consensus 146 ~~~~~i~Gg~Q~~li~~Dl~~~~e~r~~~v-~---------a~~v~im--R~Nnr~lf~G~t~G~V~LrD~~s~-----~ 208 (1118)
T KOG1275|consen 146 GPSTLIMGGLQEKLIHIDLNTEKETRTTNV-S---------ASGVTIM--RYNNRNLFCGDTRGTVFLRDPNSF-----E 208 (1118)
T ss_pred CCcceeecchhhheeeeecccceeeeeeec-c---------CCceEEE--EecCcEEEeecccceEEeecCCcC-----c
Confidence 455677788777888899999998887643 1 1224433 357889999999999999999874 6
Q ss_pred cceeeeecCCCeeEEEEecCCCCEEEEeecCC------CCCeEEEeeC
Q 000080 2310 PMESCLCFSSHAMDVSYITSSGSVIAAAGHSS------NGINVVVWDT 2351 (2389)
Q Consensus 2310 ~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS------~D~TVrLWD~ 2351 (2389)
++.++.+|++.+.++.. .|++|+|.|+|. .|.-|++||+
T Consensus 209 ~iht~~aHs~siSDfDv---~GNlLitCG~S~R~~~l~~D~FvkVYDL 253 (1118)
T KOG1275|consen 209 TIHTFDAHSGSISDFDV---QGNLLITCGYSMRRYNLAMDPFVKVYDL 253 (1118)
T ss_pred eeeeeeccccceeeeec---cCCeEEEeecccccccccccchhhhhhh
Confidence 88999999999986554 468999999865 4667999996
No 344
>KOG1275 consensus PAB-dependent poly(A) ribonuclease, subunit PAN2 [Replication, recombination and repair]
Probab=79.92 E-value=6.6 Score=53.82 Aligned_cols=104 Identities=19% Similarity=0.215 Sum_probs=73.1
Q ss_pred EcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe---------CCCcEEE
Q 000080 2227 SHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA---------LDGTVCT 2297 (2389)
Q Consensus 2227 FsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS---------~DgTVkL 2297 (2389)
.-.+++++.+|..-|+|-|-|..+-+-+.++. + |++.|. .|+=.|+.|+|++ .|.-|++
T Consensus 183 mR~Nnr~lf~G~t~G~V~LrD~~s~~~iht~~---a-------Hs~siS--DfDv~GNlLitCG~S~R~~~l~~D~FvkV 250 (1118)
T KOG1275|consen 183 MRYNNRNLFCGDTRGTVFLRDPNSFETIHTFD---A-------HSGSIS--DFDVQGNLLITCGYSMRRYNLAMDPFVKV 250 (1118)
T ss_pred EEecCcEEEeecccceEEeecCCcCceeeeee---c-------ccccee--eeeccCCeEEEeecccccccccccchhhh
Confidence 34578999999999999999999888888884 3 556664 5888999999988 4788999
Q ss_pred eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
||++.- | .+.|+ +-|-++ .-+.|.|.=-+++|.+ |.-|...+=|+
T Consensus 251 YDLRmm-r-al~PI---~~~~~P-~flrf~Psl~t~~~V~---S~sGq~q~vd~ 295 (1118)
T KOG1275|consen 251 YDLRMM-R-ALSPI---QFPYGP-QFLRFHPSLTTRLAVT---SQSGQFQFVDT 295 (1118)
T ss_pred hhhhhh-h-ccCCc---ccccCc-hhhhhcccccceEEEE---ecccceeeccc
Confidence 999986 2 22333 222222 2356777544555554 34566777774
No 345
>KOG2066 consensus Vacuolar assembly/sorting protein VPS41 [Intracellular trafficking, secretion, and vesicular transport]
Probab=78.86 E-value=12 Score=51.09 Aligned_cols=98 Identities=17% Similarity=0.237 Sum_probs=68.0
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
.+.++| +++|+=|..+|.|++.+. +|.....+ . |+.. .-+|..+||+|.||+|-+=-+-+
T Consensus 43 s~~av~--~~~~~~GtH~g~v~~~~~-~~~~~~~~----~-------~s~~------~~~Gey~asCS~DGkv~I~sl~~ 102 (846)
T KOG2066|consen 43 SCCAVH--DKFFALGTHRGAVYLTTC-QGNPKTNF----D-------HSSS------ILEGEYVASCSDDGKVVIGSLFT 102 (846)
T ss_pred HHHHhh--cceeeeccccceEEEEec-CCcccccc----c-------cccc------ccCCceEEEecCCCcEEEeeccC
Confidence 344444 678999999999999997 56552223 2 2232 77899999999999999988877
Q ss_pred CCccCcccceeeeecCCCeeEEEEecC----CCCEEEEeecCCCCCeEEEee
Q 000080 2303 GGRSNVRPMESCLCFSSHAMDVSYITS----SGSVIAAAGHSSNGINVVVWD 2350 (2389)
Q Consensus 2303 ggrs~~k~l~tl~gHs~~V~sVAFSP~----DGslLASAG~sS~D~TVrLWD 2350 (2389)
+. ...+ ..+...+.+|+++|+ ..+..++|| .-| +.|..
T Consensus 103 ~~-----~~~~-~df~rpiksial~Pd~~~~~sk~fv~GG---~ag-lvL~e 144 (846)
T KOG2066|consen 103 DD-----EITQ-YDFKRPIKSIALHPDFSRQQSKQFVSGG---MAG-LVLSE 144 (846)
T ss_pred Cc-----ccee-EecCCcceeEEeccchhhhhhhheeecC---cce-EEEeh
Confidence 52 2222 235678899999995 245566764 333 77765
No 346
>KOG2395 consensus Protein involved in vacuole import and degradation [Intracellular trafficking, secretion, and vesicular transport]
Probab=78.77 E-value=8.8 Score=50.29 Aligned_cols=135 Identities=11% Similarity=0.131 Sum_probs=93.3
Q ss_pred CCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCC--EEE-----EEeCCCcEEEeeCC
Q 000080 2230 LRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGH--RFA-----SAALDGTVCTWQLE 2301 (2389)
Q Consensus 2230 dG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~--~LA-----SgS~DgTVkLWDl~ 2301 (2389)
+.+ +|.+|..-..++-=|+++|+-+.++.. | ..|.-|.|.||++ .+. .|=.|+.|.-||.+
T Consensus 344 dsnlil~~~~~~~~l~klDIE~GKIVeEWk~----------~-~di~mv~~t~d~K~~Ql~~e~TlvGLs~n~vfriDpR 412 (644)
T KOG2395|consen 344 DSNLILMDGGEQDKLYKLDIERGKIVEEWKF----------E-DDINMVDITPDFKFAQLTSEQTLVGLSDNSVFRIDPR 412 (644)
T ss_pred ccceEeeCCCCcCcceeeecccceeeeEeec----------c-CCcceeeccCCcchhcccccccEEeecCCceEEeccc
Confidence 344 455677777889999999999988862 2 3489999999974 333 34568999999999
Q ss_pred CCCccCcccceeeeecCC----CeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCc-eEEEEeecCcEEEEeecc
Q 000080 2302 VGGRSNVRPMESCLCFSS----HAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSS-RASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus 2302 tggrs~~k~l~tl~gHs~----~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~-v~sL~GH~~~V~svA~~~ 2376 (2389)
..+. ..+.--++|.. .-.+++--. +|. ||.| |.+|.|||+|- .+.. -..|.|--..|.-|..+-
T Consensus 413 v~~~---~kl~~~q~kqy~~k~nFsc~aTT~-sG~-Ivvg---S~~GdIRLYdr---i~~~AKTAlPgLG~~I~hVdvta 481 (644)
T KOG2395|consen 413 VQGK---NKLAVVQSKQYSTKNNFSCFATTE-SGY-IVVG---SLKGDIRLYDR---IGRRAKTALPGLGDAIKHVDVTA 481 (644)
T ss_pred ccCc---ceeeeeeccccccccccceeeecC-Cce-EEEe---ecCCcEEeehh---hhhhhhhcccccCCceeeEEeec
Confidence 7542 12233344442 112333333 555 5544 69999999995 2333 346788888999999999
Q ss_pred cchhhhcccc
Q 000080 2377 LLNFALSKCR 2386 (2389)
Q Consensus 2377 ~~~~~~s~~~ 2386 (2389)
+|.|+|-.|.
T Consensus 482 dGKwil~Tc~ 491 (644)
T KOG2395|consen 482 DGKWILATCK 491 (644)
T ss_pred cCcEEEEecc
Confidence 9999998886
No 347
>PF07995 GSDH: Glucose / Sorbosone dehydrogenase; InterPro: IPR012938 Proteins containing this domain are thought to be glucose/sorbosone dehydrogenases. The best characterised of these proteins is soluble glucose dehydrogenase (P13650 from SWISSPROT) from Acinetobacter calcoaceticus, which oxidises glucose to gluconolactone. The enzyme is a calcium-dependent homodimer which uses PQQ as a cofactor [].; GO: 0016901 oxidoreductase activity, acting on the CH-OH group of donors, quinone or similar compound as acceptor, 0048038 quinone binding, 0005975 carbohydrate metabolic process; PDB: 2ISM_A 2WG3_D 3HO5_A 3HO4_A 3HO3_A 2WFT_A 2WG4_B 2WFX_B 1CRU_A 1CQ1_B ....
Probab=78.11 E-value=15 Score=45.96 Aligned_cols=111 Identities=13% Similarity=0.171 Sum_probs=62.6
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC----CCEEEEEeCC------
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY----GHRFASAALD------ 2292 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD----G~~LASgS~D------ 2292 (2389)
++++|.|||+++++ -..|+|++.+ .+|.....+..++ .+. .........++|+|+ |...++-+.+
T Consensus 5 ~~~a~~pdG~l~v~-e~~G~i~~~~-~~g~~~~~v~~~~--~v~-~~~~~gllgia~~p~f~~n~~lYv~~t~~~~~~~~ 79 (331)
T PF07995_consen 5 RSMAFLPDGRLLVA-ERSGRIWVVD-KDGSLKTPVADLP--EVF-ADGERGLLGIAFHPDFASNGYLYVYYTNADEDGGD 79 (331)
T ss_dssp EEEEEETTSCEEEE-ETTTEEEEEE-TTTEECEEEEE-T--TTB-TSTTBSEEEEEE-TTCCCC-EEEEEEEEE-TSSSS
T ss_pred eEEEEeCCCcEEEE-eCCceEEEEe-CCCcCcceecccc--ccc-ccccCCcccceeccccCCCCEEEEEEEcccCCCCC
Confidence 88999999999886 5599999999 5565412221111 111 122467899999995 7777776643
Q ss_pred --CcEEEeeCCCCCc--cCcccc-eeeee---cCCCeeEEEEecCCCCEEEEeec
Q 000080 2293 --GTVCTWQLEVGGR--SNVRPM-ESCLC---FSSHAMDVSYITSSGSVIAAAGH 2339 (2389)
Q Consensus 2293 --gTVkLWDl~tggr--s~~k~l-~tl~g---Hs~~V~sVAFSP~DGslLASAG~ 2339 (2389)
..|.-|.+..+.. ...+.+ ..+.. ..+....++|.| ||.+.++.|.
T Consensus 80 ~~~~v~r~~~~~~~~~~~~~~~l~~~~p~~~~~~H~g~~l~fgp-DG~LYvs~G~ 133 (331)
T PF07995_consen 80 NDNRVVRFTLSDGDGDLSSEEVLVTGLPDTSSGNHNGGGLAFGP-DGKLYVSVGD 133 (331)
T ss_dssp EEEEEEEEEEETTSCEEEEEEEEEEEEES-CSSSS-EEEEEE-T-TSEEEEEEB-
T ss_pred cceeeEEEeccCCccccccceEEEEEeCCCCCCCCCCccccCCC-CCcEEEEeCC
Confidence 3444444432210 001112 12222 234456799999 9999998874
No 348
>KOG2079 consensus Vacuolar assembly/sorting protein VPS8 [Intracellular trafficking, secretion, and vesicular transport]
Probab=77.62 E-value=5.4 Score=55.45 Aligned_cols=72 Identities=13% Similarity=0.310 Sum_probs=54.2
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
.+|.+++|+.||.+++.|=.+|.|.+||+.+++.++.+. .|..| | ..|-.+-...++..+.++...|. +|+
T Consensus 131 ~~Vtsvafn~dg~~l~~G~~~G~V~v~D~~~~k~l~~i~---e~~ap---~-t~vi~v~~t~~nS~llt~D~~Gs--f~~ 201 (1206)
T KOG2079|consen 131 GPVTSVAFNQDGSLLLAGLGDGHVTVWDMHRAKILKVIT---EHGAP---V-TGVIFVGRTSQNSKLLTSDTGGS--FWK 201 (1206)
T ss_pred CcceeeEecCCCceeccccCCCcEEEEEccCCcceeeee---ecCCc---c-ceEEEEEEeCCCcEEEEccCCCc--eEE
Confidence 367999999999999999999999999999998877664 23212 2 23444455566678888888885 675
Q ss_pred C
Q 000080 2300 L 2300 (2389)
Q Consensus 2300 l 2300 (2389)
+
T Consensus 202 l 202 (1206)
T KOG2079|consen 202 L 202 (1206)
T ss_pred E
Confidence 4
No 349
>PF12894 Apc4_WD40: Anaphase-promoting complex subunit 4 WD40 domain
Probab=77.22 E-value=4.4 Score=37.59 Aligned_cols=33 Identities=9% Similarity=0.243 Sum_probs=29.1
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCcee
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKAT 2254 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l 2254 (2389)
.|..++|+|+..+||.|+.||.|.++.+ +++.+
T Consensus 13 ~v~~~~w~P~mdLiA~~t~~g~v~v~Rl-~~qri 45 (47)
T PF12894_consen 13 RVSCMSWCPTMDLIALGTEDGEVLVYRL-NWQRI 45 (47)
T ss_pred cEEEEEECCCCCEEEEEECCCeEEEEEC-CCcCc
Confidence 3588999999999999999999999998 66643
No 350
>KOG2114 consensus Vacuolar assembly/sorting protein PEP5/VPS11 [Intracellular trafficking, secretion, and vesicular transport]
Probab=76.31 E-value=26 Score=48.36 Aligned_cols=111 Identities=13% Similarity=0.129 Sum_probs=73.9
Q ss_pred EEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCc-----EEEeeC
Q 000080 2226 SSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGT-----VCTWQL 2300 (2389)
Q Consensus 2226 AFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgT-----VkLWDl 2300 (2389)
++++.+..+|-|+.||.|-+.+- +-+.++.|+ ++. | +-|..+..-.+.+.|+|.++|++ |++||+
T Consensus 30 c~~s~~~~vvigt~~G~V~~Ln~-s~~~~~~fq---a~~-----~-siv~~L~~~~~~~~L~sv~Ed~~~np~llkiw~l 99 (933)
T KOG2114|consen 30 CCSSSTGSVVIGTADGRVVILNS-SFQLIRGFQ---AYE-----Q-SIVQFLYILNKQNFLFSVGEDEQGNPVLLKIWDL 99 (933)
T ss_pred EEcCCCceEEEeeccccEEEecc-cceeeehhe---ecc-----h-hhhhHhhcccCceEEEEEeecCCCCceEEEEecc
Confidence 58999999999999998877763 223445554 331 1 23555555556689999888865 999999
Q ss_pred CCCCccC-ccccee--eee-----cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEee
Q 000080 2301 EVGGRSN-VRPMES--CLC-----FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWD 2350 (2389)
Q Consensus 2301 ~tggrs~-~k~l~t--l~g-----Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD 2350 (2389)
+.....+ +++++. ... -+.++..++.+. |=+.+|. |+ .||+|-...
T Consensus 100 ek~~~n~sP~c~~~~ri~~~~np~~~~p~s~l~Vs~-~l~~Iv~-Gf--~nG~V~~~~ 153 (933)
T KOG2114|consen 100 EKVDKNNSPQCLYEHRIFTIKNPTNPSPASSLAVSE-DLKTIVC-GF--TNGLVICYK 153 (933)
T ss_pred cccCCCCCcceeeeeeeeccCCCCCCCcceEEEEEc-cccEEEE-Ee--cCcEEEEEc
Confidence 8642112 334422 122 245677899998 6788887 55 688888876
No 351
>PF10647 Gmad1: Lipoprotein LpqB beta-propeller domain; InterPro: IPR018910 The Gmad1 domain is found associated with IPR019606 from INTERPRO, in bacterial spore formation. It is predicted to have a beta-propeller fold and to have a passive binding role rather than a catalytic function owing to the low number of conserved hydrophilic residues.
Probab=76.24 E-value=32 Score=41.51 Aligned_cols=115 Identities=18% Similarity=0.132 Sum_probs=71.2
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEee-cCCCceeeE-ecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe---CCCcEEE
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWE-FGKDKATAT-YGVLPAANVPPPYALASISALQFDHYGHRFASAA---LDGTVCT 2297 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWD-l~tGk~l~T-l~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS---~DgTVkL 2297 (2389)
.+-+|.++|...+....+...+++. ..+|+.... ... + +-...|+++++||||.++|.-. .++.|.+
T Consensus 69 ~~PS~d~~g~~W~v~~~~~~~~~~~~~~~g~~~~~~v~~------~--~~~~~I~~l~vSpDG~RvA~v~~~~~~~~v~v 140 (253)
T PF10647_consen 69 TRPSWDPDGWVWTVDDGSGGVRVVRDSASGTGEPVEVDW------P--GLRGRITALRVSPDGTRVAVVVEDGGGGRVYV 140 (253)
T ss_pred ccccccCCCCEEEEEcCCCceEEEEecCCCcceeEEecc------c--ccCCceEEEEECCCCcEEEEEEecCCCCeEEE
Confidence 5558999998888777788888884 334443222 210 1 1112799999999999999877 3466666
Q ss_pred eeCCCCCc----cCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEE
Q 000080 2298 WQLEVGGR----SNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVV 2348 (2389)
Q Consensus 2298 WDl~tggr----s~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrL 2348 (2389)
=-+...+. ....++.........+.+++|.+ ++++++.+. ..|..+..
T Consensus 141 a~V~r~~~g~~~~l~~~~~~~~~~~~~v~~v~W~~-~~~L~V~~~--~~~~~~~~ 192 (253)
T PF10647_consen 141 AGVVRDGDGVPRRLTGPRRVAPPLLSDVTDVAWSD-DSTLVVLGR--SAGGPVVR 192 (253)
T ss_pred EEEEeCCCCCcceeccceEecccccCcceeeeecC-CCEEEEEeC--CCCCceeE
Confidence 55543211 01122222223456889999999 777776543 45555544
No 352
>PF14870 PSII_BNR: Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=76.10 E-value=24 Score=44.11 Aligned_cols=105 Identities=15% Similarity=0.188 Sum_probs=57.0
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCC-ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKD-KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tG-k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
.++++..++||+++|.++...-.+-||-+.. .....- .-..+|.++.|+|||.....+ ..|.|+.=+
T Consensus 146 s~~~~~r~~dG~~vavs~~G~~~~s~~~G~~~w~~~~r-----------~~~~riq~~gf~~~~~lw~~~-~Gg~~~~s~ 213 (302)
T PF14870_consen 146 SINDITRSSDGRYVAVSSRGNFYSSWDPGQTTWQPHNR-----------NSSRRIQSMGFSPDGNLWMLA-RGGQIQFSD 213 (302)
T ss_dssp -EEEEEE-TTS-EEEEETTSSEEEEE-TT-SS-EEEE-------------SSS-EEEEEE-TTS-EEEEE-TTTEEEEEE
T ss_pred eeEeEEECCCCcEEEEECcccEEEEecCCCccceEEcc-----------CccceehhceecCCCCEEEEe-CCcEEEEcc
Confidence 3478899999999999877777789996533 222221 124789999999998876655 778777755
Q ss_pred CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEee
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAG 2338 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG 2338 (2389)
.......-.+++....--...+.+++|.+ ++++.|++|
T Consensus 214 ~~~~~~~w~~~~~~~~~~~~~~ld~a~~~-~~~~wa~gg 251 (302)
T PF14870_consen 214 DPDDGETWSEPIIPIKTNGYGILDLAYRP-PNEIWAVGG 251 (302)
T ss_dssp -TTEEEEE---B-TTSS--S-EEEEEESS-SS-EEEEES
T ss_pred CCCCccccccccCCcccCceeeEEEEecC-CCCEEEEeC
Confidence 11100000011111111123478999999 778888764
No 353
>PF10168 Nup88: Nuclear pore component; InterPro: IPR019321 Nup88 can be divided into two structural domains; the N-terminal two-thirds of the protein have no obvious structural motifs. It is, however, where it binds to Nup98; one of the components of the nuclear pore. The C-terminal end is a predicted coiled-coil domain []. Nup88 is over expressed in tumour cells [].
Probab=75.70 E-value=9.7 Score=52.31 Aligned_cols=88 Identities=22% Similarity=0.297 Sum_probs=59.5
Q ss_pred CCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCC---cccccccccccceeeeec------cCCCCCeeEEEEcCCC
Q 000080 36 APTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSP---LSQEEALIGPIFRQVFAL------SDNSLPVTSISWSPET 106 (2389)
Q Consensus 36 ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP---~~~~e~~~~p~~~Qvieg------h~d~~dVk~VaWSPd~ 106 (2389)
.|.-++..|..+|+ | ..+|-.+...|+|..||.. ...|+-.---+.+..++. ......|..|+|||..
T Consensus 82 ~~~f~v~~i~~n~~--g-~~lal~G~~~v~V~~LP~r~g~~~~~~~g~~~i~Crt~~v~~~~~~~~~~~~i~qv~WhP~s 158 (717)
T PF10168_consen 82 PPLFEVHQISLNPT--G-SLLALVGPRGVVVLELPRRWGKNGEFEDGKKEINCRTVPVDERFFTSNSSLEIKQVRWHPWS 158 (717)
T ss_pred CCceeEEEEEECCC--C-CEEEEEcCCcEEEEEeccccCccccccCCCcceeEEEEEechhhccCCCCceEEEEEEcCCC
Confidence 36678888888888 7 5899999999999999862 222321111123444422 1112579999999974
Q ss_pred CCCCcEEE-ecCCeEEEEeeC
Q 000080 107 PSIGQLAA-ASENCIFVFAHD 126 (2389)
Q Consensus 107 ~~~GeIaA-SyDntIRVw~~d 126 (2389)
+.+.-|++ .+||++|+|.-.
T Consensus 159 ~~~~~l~vLtsdn~lR~y~~~ 179 (717)
T PF10168_consen 159 ESDSHLVVLTSDNTLRLYDIS 179 (717)
T ss_pred CCCCeEEEEecCCEEEEEecC
Confidence 44455665 789999999875
No 354
>TIGR02604 Piru_Ver_Nterm putative membrane-bound dehydrogenase domain. All proteins that score above the trusted cutoff score of 45 to this model are large proteins of either Pirellula sp. 1 or Verrucomicrobium spinosum. These proteins all contain, in addition to this domain, several hundred residues of highly variable sequence, and then a well-conserved C-terminal domain (TIGR02603) that features a putative cytochrome c-type heme binding motif CXXCH. The membrane-bound L-sorbosone dehydrogenase from Acetobacter liquefaciens (Gluconacetobacter liquefaciens) is homologous to this domain but lacks additional sequence regions shared by members of this family and belongs to a different clade of the larger family of homologs. It and its closely related homologs are excluded from the this model by scoring between the trusted (45) and noise (18) cutoffs.
Probab=74.96 E-value=34 Score=43.22 Aligned_cols=148 Identities=7% Similarity=-0.023 Sum_probs=79.2
Q ss_pred EEEEEcCCCCeEEEEe-----------CCC-cEEEeecCC--Cce--eeEecccCCCCCCCCCCCCCEEEEEECCCCCEE
Q 000080 2223 RAFSSHPLRPFFLVGS-----------SNT-HIYLWEFGK--DKA--TATYGVLPAANVPPPYALASISALQFDHYGHRF 2286 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS-----------~Dg-TIRLWDl~t--Gk~--l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~L 2286 (2389)
++|+|.++|+++++-. ..+ .|.+++-.+ |+. ...|. . .....+.++|.++| .+
T Consensus 17 ~~ia~d~~G~l~V~e~~~y~~~~~~~~~~~~rI~~l~d~dgdG~~d~~~vfa---~-------~l~~p~Gi~~~~~G-ly 85 (367)
T TIGR02604 17 IAVCFDERGRLWVAEGITYSRPAGRQGPLGDRILILEDADGDGKYDKSNVFA---E-------ELSMVTGLAVAVGG-VY 85 (367)
T ss_pred ceeeECCCCCEEEEeCCcCCCCCCCCCCCCCEEEEEEcCCCCCCcceeEEee---c-------CCCCccceeEecCC-EE
Confidence 7889999999888743 223 787776543 332 23331 1 12446889999999 66
Q ss_pred EEEeCCCcEEEeeCCCCCcc--Ccccce-eeee----cCCCeeEEEEecCCCCEEEEeecCCCCCe--------------
Q 000080 2287 ASAALDGTVCTWQLEVGGRS--NVRPME-SCLC----FSSHAMDVSYITSSGSVIAAAGHSSNGIN-------------- 2345 (2389)
Q Consensus 2287 ASgS~DgTVkLWDl~tggrs--~~k~l~-tl~g----Hs~~V~sVAFSP~DGslLASAG~sS~D~T-------------- 2345 (2389)
++ +.+.-.++.|.+..++. ..+.+. .+.. +......++|.| ||.+.++-|..+.-.+
T Consensus 86 V~-~~~~i~~~~d~~gdg~ad~~~~~l~~~~~~~~~~~~~~~~~l~~gp-DG~LYv~~G~~~~~~~~~~~~~~~~~~~~~ 163 (367)
T TIGR02604 86 VA-TPPDILFLRDKDGDDKADGEREVLLSGFGGQINNHHHSLNSLAWGP-DGWLYFNHGNTLASKVTRPGTSDESRQGLG 163 (367)
T ss_pred Ee-CCCeEEEEeCCCCCCCCCCccEEEEEccCCCCCcccccccCceECC-CCCEEEecccCCCceeccCCCccCcccccC
Confidence 64 45554455566432110 001121 1211 234467899999 9999887652110000
Q ss_pred EEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080 2346 VVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2346 VrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
=.+|.+. +.+..+..+...-...+.++++++|+.-++-
T Consensus 164 g~i~r~~-pdg~~~e~~a~G~rnp~Gl~~d~~G~l~~td 201 (367)
T TIGR02604 164 GGLFRYN-PDGGKLRVVAHGFQNPYGHSVDSWGDVFFCD 201 (367)
T ss_pred ceEEEEe-cCCCeEEEEecCcCCCccceECCCCCEEEEc
Confidence 0244432 2233333332222234578888888876553
No 355
>KOG2444 consensus WD40 repeat protein [General function prediction only]
Probab=74.79 E-value=5.5 Score=47.69 Aligned_cols=68 Identities=16% Similarity=0.114 Sum_probs=50.8
Q ss_pred EEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCC-CCEEEEEECCCCCEEEEE--eCCCcEEEeeCC
Q 000080 2225 FSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYAL-ASISALQFDHYGHRFASA--ALDGTVCTWQLE 2301 (2389)
Q Consensus 2225 VAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~-~~V~sVaFSPDG~~LASg--S~DgTVkLWDl~ 2301 (2389)
|.--.++.+..+|+.||.||.|++..++-+- +. + +|. ..+....-+.-|+.++++ |.|.+++.|+++
T Consensus 108 Ip~~~~~~~~c~~~~dg~ir~~n~~p~k~~g-~~---g------~h~~~~~e~~ivv~sd~~i~~a~~S~d~~~k~W~ve 177 (238)
T KOG2444|consen 108 IPNGRDSSLGCVGAQDGRIRACNIKPNKVLG-YV---G------QHNFESGEELIVVGSDEFLKIADTSHDRVLKKWNVE 177 (238)
T ss_pred cccccccceeEEeccCCceeeeccccCceee-ee---c------cccCCCcceeEEecCCceEEeeccccchhhhhcchh
Confidence 3445566688999999999999998777543 22 1 244 456666666777888888 999999999997
Q ss_pred C
Q 000080 2302 V 2302 (2389)
Q Consensus 2302 t 2302 (2389)
.
T Consensus 178 ~ 178 (238)
T KOG2444|consen 178 K 178 (238)
T ss_pred h
Confidence 5
No 356
>KOG2114 consensus Vacuolar assembly/sorting protein PEP5/VPS11 [Intracellular trafficking, secretion, and vesicular transport]
Probab=74.35 E-value=41 Score=46.57 Aligned_cols=132 Identities=14% Similarity=0.135 Sum_probs=89.4
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEee--cCCCceee-EecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEE
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWE--FGKDKATA-TYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCT 2297 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWD--l~tGk~l~-Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkL 2297 (2389)
++..|+.|.+-+.+|.|=.||.|.+.. +.+.+-.+ .+. |+ | ..+|+.++|.-||+...-+..-..|.+
T Consensus 127 p~s~l~Vs~~l~~Iv~Gf~nG~V~~~~GDi~RDrgsr~~~~----~~----~-~~pITgL~~~~d~~s~lFv~Tt~~V~~ 197 (933)
T KOG2114|consen 127 PASSLAVSEDLKTIVCGFTNGLVICYKGDILRDRGSRQDYS----HR----G-KEPITGLALRSDGKSVLFVATTEQVML 197 (933)
T ss_pred cceEEEEEccccEEEEEecCcEEEEEcCcchhccccceeee----cc----C-CCCceeeEEecCCceeEEEEecceeEE
Confidence 567889999999999999999999985 22222222 232 11 1 267999999999987333444467999
Q ss_pred eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE-eecCcEEEE
Q 000080 2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT-CHEGLYDLF 2372 (2389)
Q Consensus 2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~-GH~~~V~sv 2372 (2389)
+.+. | |. .....+..|...+++.+|++.++++|.+ | +.-|.++|.. ..+..-.|. ||.....++
T Consensus 198 y~l~-g-r~--p~~~~ld~~G~~lnCss~~~~t~qfIca-~----~e~l~fY~sd--~~~~cfaf~~g~kk~~~~~ 262 (933)
T KOG2114|consen 198 YSLS-G-RT--PSLKVLDNNGISLNCSSFSDGTYQFICA-G----SEFLYFYDSD--GRGPCFAFEVGEKKEMLVF 262 (933)
T ss_pred EEec-C-CC--cceeeeccCCccceeeecCCCCccEEEe-c----CceEEEEcCC--CcceeeeecCCCeEEEEEE
Confidence 9988 3 21 1245577888999999999866666664 2 4579999962 223345666 766555443
No 357
>PF08553 VID27: VID27 cytoplasmic protein; InterPro: IPR013863 This entry represents fungal and plant proteins and contains many hypothetical proteins. Vid27p is a cytoplasmic protein of unknown function, possibly regulates import of fructose-1,6-bisphosphatase into Vacuolar Import and Degradation (Vid) vesicles and is not essential for proteasome-dependent degradation of fructose-1,6-bisphosphatase (FBPase) [, ].
Probab=73.92 E-value=27 Score=48.62 Aligned_cols=104 Identities=14% Similarity=0.198 Sum_probs=73.1
Q ss_pred EEEEeCCCcEEEeecCCC--ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccc
Q 000080 2234 FLVGSSNTHIYLWEFGKD--KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPM 2311 (2389)
Q Consensus 2234 LASGS~DgTIRLWDl~tG--k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l 2311 (2389)
-..|=.+..+-.||.+-. +++.+ ..|.. ......+|++=+.+| .||.||.+|-|||+| +.|. +.-
T Consensus 545 tflGls~n~lfriDpR~~~~k~v~~----~~k~Y---~~~~~Fs~~aTt~~G-~iavgs~~G~IRLyd-~~g~----~AK 611 (794)
T PF08553_consen 545 TFLGLSDNSLFRIDPRLSGNKLVDS----QSKQY---SSKNNFSCFATTEDG-YIAVGSNKGDIRLYD-RLGK----RAK 611 (794)
T ss_pred eEEEECCCceEEeccCCCCCceeec----ccccc---ccCCCceEEEecCCc-eEEEEeCCCcEEeec-ccch----hhh
Confidence 344778888999998743 23321 11211 122457788888888 799999999999998 4442 333
Q ss_pred eeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCC
Q 000080 2312 ESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPP 2355 (2389)
Q Consensus 2312 ~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~t 2355 (2389)
..+.|...+|..|..+. ||++|+.+ -+.-+-|.|+....
T Consensus 612 T~lp~lG~pI~~iDvt~-DGkwilaT----c~tyLlLi~t~~~~ 650 (794)
T PF08553_consen 612 TALPGLGDPIIGIDVTA-DGKWILAT----CKTYLLLIDTLIKD 650 (794)
T ss_pred hcCCCCCCCeeEEEecC-CCcEEEEe----ecceEEEEEEeeec
Confidence 44567789999999999 99988753 47789999985433
No 358
>PLN00033 photosystem II stability/assembly factor; Provisional
Probab=73.88 E-value=70 Score=41.57 Aligned_cols=144 Identities=13% Similarity=0.250 Sum_probs=85.1
Q ss_pred eeecCCCCCCeEEEEecCCcEEEEeCCCCcccc-cccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEEecCCeEEE
Q 000080 44 IDWLPDFAGYSWVAYGASSLLVISHFPSPLSQE-EALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAAASENCIFV 122 (2389)
Q Consensus 44 i~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~-e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaASyDntIRV 122 (2389)
+.-++| | ..++++....++.++ ++-..+ +.+ +... ...+..+.|.++ ++-++++-++.+.
T Consensus 244 v~~~~d--G-~~~~vg~~G~~~~s~--d~G~~~W~~~---------~~~~-~~~l~~v~~~~d---g~l~l~g~~G~l~- 304 (398)
T PLN00033 244 VNRSPD--G-DYVAVSSRGNFYLTW--EPGQPYWQPH---------NRAS-ARRIQNMGWRAD---GGLWLLTRGGGLY- 304 (398)
T ss_pred EEEcCC--C-CEEEEECCccEEEec--CCCCcceEEe---------cCCC-ccceeeeeEcCC---CCEEEEeCCceEE-
Confidence 344566 6 488999988888888 422221 222 2221 246899999997 5445566555543
Q ss_pred EeeCCCCCCCCccceeeEEecccceEEEEeecCCCCeEEEEecc-eEEeeccCCcEEEEEEeeccccceEEEEeecCCCc
Q 000080 123 FAHDSASSKGSFCWSQNAILVQGTKVEAIEWTGSGDGIVAGGME-TVLWKKKNTLWEIAWKFKENYPQNLVSATWSIEGP 201 (2389)
Q Consensus 123 w~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSpdG~rLaSggdD-V~IW~~~~s~Wecvwt~~~~~~~~ivsvaWSpdG~ 201 (2389)
+..+...+-...+|.....-.....+.++.|.+++..+++|... +.........|+.+=. ...-+.++|++.|.+++.
T Consensus 305 ~S~d~G~~~~~~~f~~~~~~~~~~~l~~v~~~~d~~~~a~G~~G~v~~s~D~G~tW~~~~~-~~~~~~~ly~v~f~~~~~ 383 (398)
T PLN00033 305 VSKGTGLTEEDFDFEEADIKSRGFGILDVGYRSKKEAWAAGGSGILLRSTDGGKSWKRDKG-ADNIAANLYSVKFFDDKK 383 (398)
T ss_pred EecCCCCcccccceeecccCCCCcceEEEEEcCCCcEEEEECCCcEEEeCCCCcceeEccc-cCCCCcceeEEEEcCCCc
Confidence 33331100000122221111123468999999999988888887 4455556678987521 122356899999988888
Q ss_pred -eEeeec
Q 000080 202 -SATAAS 207 (2389)
Q Consensus 202 -fATag~ 207 (2389)
+|++-.
T Consensus 384 g~~~G~~ 390 (398)
T PLN00033 384 GFVLGND 390 (398)
T ss_pred eEEEeCC
Confidence 887743
No 359
>KOG0882 consensus Cyclophilin-related peptidyl-prolyl cis-trans isomerase [Posttranslational modification, protein turnover, chaperones]
Probab=72.41 E-value=7.2 Score=50.11 Aligned_cols=144 Identities=15% Similarity=0.050 Sum_probs=91.7
Q ss_pred EcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-CCcEEEeeCCCCCc
Q 000080 2227 SHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-DGTVCTWQLEVGGR 2305 (2389)
Q Consensus 2227 FsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-DgTVkLWDl~tggr 2305 (2389)
|-.-..++++||-||++|.|--. +-....|- -|. ..|...|.+++-|.||..+.|++. |..+|+.|++.-.
T Consensus 16 ~~tka~fiiqASlDGh~KFWkKs-~isGvEfV---KhF---raHL~~I~sl~~S~dg~L~~Sv~d~Dhs~KvfDvEn~D- 87 (558)
T KOG0882|consen 16 FPTKAKFIIQASLDGHKKFWKKS-RISGVEFV---KHF---RAHLGVILSLAVSYDGWLFRSVEDPDHSVKVFDVENFD- 87 (558)
T ss_pred eeehhheEEeeecchhhhhcCCC-Cccceeeh---hhh---HHHHHHHHhhhccccceeEeeccCcccceeEEEeeccc-
Confidence 44457799999999999999853 21122221 111 236688999999999999999888 9999999998742
Q ss_pred cCcccceeeeecCCCeeEEEEecCCCC-EEEEeecCCCCCeEEEeeCCCCCCCce-EEEEeecCcEEEEeecccchhhhc
Q 000080 2306 SNVRPMESCLCFSSHAMDVSYITSSGS-VIAAAGHSSNGINVVVWDTLAPPTSSR-ASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus 2306 s~~k~l~tl~gHs~~V~sVAFSP~DGs-lLASAG~sS~D~TVrLWD~l~~tg~~v-~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
... ...+.-..+.+ +..++|+|-. .||.+ .-+++.|-+.|-. ...... ..-.-|.++|.++-..+-|+-++|
T Consensus 88 -min-miKL~~lPg~a-~wv~skGd~~s~IAVs--~~~sg~i~VvD~~-~d~~q~~~fkklH~sPV~~i~y~qa~Ds~vS 161 (558)
T KOG0882|consen 88 -MIN-MIKLVDLPGFA-EWVTSKGDKISLIAVS--LFKSGKIFVVDGF-GDFCQDGYFKKLHFSPVKKIRYNQAGDSAVS 161 (558)
T ss_pred -hhh-hcccccCCCce-EEecCCCCeeeeEEee--cccCCCcEEECCc-CCcCccceecccccCceEEEEeeccccceee
Confidence 111 11111122222 2334542212 44443 2477889999963 122223 333459999999999998888777
Q ss_pred c
Q 000080 2384 K 2384 (2389)
Q Consensus 2384 ~ 2384 (2389)
-
T Consensus 162 i 162 (558)
T KOG0882|consen 162 I 162 (558)
T ss_pred c
Confidence 4
No 360
>PF12894 Apc4_WD40: Anaphase-promoting complex subunit 4 WD40 domain
Probab=72.15 E-value=7.5 Score=36.14 Aligned_cols=30 Identities=20% Similarity=0.279 Sum_probs=28.2
Q ss_pred CCEEEEEECCCCCEEEEEeCCCcEEEeeCC
Q 000080 2272 ASISALQFDHYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus 2272 ~~V~sVaFSPDG~~LASgS~DgTVkLWDl~ 2301 (2389)
..|..++|+|..+.||.|+.||.|.++.++
T Consensus 12 ~~v~~~~w~P~mdLiA~~t~~g~v~v~Rl~ 41 (47)
T PF12894_consen 12 SRVSCMSWCPTMDLIALGTEDGEVLVYRLN 41 (47)
T ss_pred CcEEEEEECCCCCEEEEEECCCeEEEEECC
Confidence 569999999999999999999999999884
No 361
>PF14783 BBS2_Mid: Ciliary BBSome complex subunit 2, middle region
Probab=71.47 E-value=59 Score=35.60 Aligned_cols=99 Identities=17% Similarity=0.163 Sum_probs=59.9
Q ss_pred eeEEEEcCC-CCCCCcEEE-ecCCeEEEEeeCCCCCCCCccceeeEEecccceEEEEeecCCCCeEEEEec-c-eEEeec
Q 000080 97 VTSISWSPE-TPSIGQLAA-ASENCIFVFAHDSASSKGSFCWSQNAILVQGTKVEAIEWTGSGDGIVAGGM-E-TVLWKK 172 (2389)
Q Consensus 97 Vk~VaWSPd-~~~~GeIaA-SyDntIRVw~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSpdG~rLaSggd-D-V~IW~~ 172 (2389)
|.+++.+.- .+|..+|++ |-|..||||+.+ + ....++.+.+|-++.=.+.+ +.+-+-. + |.+++.
T Consensus 2 V~al~~~d~d~dg~~eLlvGs~D~~IRvf~~~------e----~~~Ei~e~~~v~~L~~~~~~-~F~Y~l~NGTVGvY~~ 70 (111)
T PF14783_consen 2 VTALCLFDFDGDGENELLVGSDDFEIRVFKGD------E----IVAEITETDKVTSLCSLGGG-RFAYALANGTVGVYDR 70 (111)
T ss_pred eeEEEEEecCCCCcceEEEecCCcEEEEEeCC------c----EEEEEecccceEEEEEcCCC-EEEEEecCCEEEEEeC
Confidence 566666652 223346776 568999999987 2 23344578888888877764 4554444 3 999998
Q ss_pred cCCcEEEEEEeecccc-ceEEEEeecCCCc--eEeeecccc
Q 000080 173 KNTLWEIAWKFKENYP-QNLVSATWSIEGP--SATAASMSQ 210 (2389)
Q Consensus 173 ~~s~Wecvwt~~~~~~-~~ivsvaWSpdG~--fATag~dik 210 (2389)
....|+.- ..+. ..+..++-.-||. +.++-...|
T Consensus 71 ~~RlWRiK----SK~~~~~~~~~D~~gdG~~eLI~GwsnGk 107 (111)
T PF14783_consen 71 SQRLWRIK----SKNQVTSMAFYDINGDGVPELIVGWSNGK 107 (111)
T ss_pred cceeeeec----cCCCeEEEEEEcCCCCCceEEEEEecCCe
Confidence 77777743 3332 2222333334565 777755443
No 362
>PF11715 Nup160: Nucleoporin Nup120/160; InterPro: IPR021717 Nup120 is conserved from fungi to plants to humans, and is homologous with the Nup160 of vertebrates. The nuclear core complex, or NPC, mediates macromolecular transport across the nuclear envelope. Deletion of the NUP120 gene causes clustering of NPCs at one side of the nuclear envelope, moderate nucleolar fragmentation and slower cell growth []. The vertebrate NPC is estimated to contain between 30 and 60 different proteins. most of which are not known. Two important ones in creating the nucleoporin basket are Nup98 and Nup153, and Nup120, in conjunction with Nup 133, interacts with these two and itself plays a role in mRNA export []. Nup160, Nup133, Nup96, and Nup107 are all targets of phosphorylation. The phosphorylation sites are clustered mainly at the N-terminal regions of these proteins, which are predicted to be natively disordered. The entire Nup107-160 subcomplex is stable throughout the cell cycle, thus it seems unlikely that phosphorylation affects interactions within the Nup107-160 subcomplex, but rather that it regulates the association of the subcomplex with the NPC and other proteins []. ; PDB: 3F7F_D 3H7N_D 3HXR_A.
Probab=70.58 E-value=14 Score=48.80 Aligned_cols=36 Identities=14% Similarity=0.311 Sum_probs=28.2
Q ss_pred EEEEEcC----CCCeEEEEeCCCcEEEeecCCCceeeEec
Q 000080 2223 RAFSSHP----LRPFFLVGSSNTHIYLWEFGKDKATATYG 2258 (2389)
Q Consensus 2223 rsVAFsP----dG~~LASGS~DgTIRLWDl~tGk~l~Tl~ 2258 (2389)
.+++.++ +..+|++-+.|+++|+||+.+++++.+..
T Consensus 218 ~~~~~~~~~~~~~~~l~tl~~D~~LRiW~l~t~~~~~~~~ 257 (547)
T PF11715_consen 218 ASLAVSSSEINDDTFLFTLSRDHTLRIWSLETGQCLATID 257 (547)
T ss_dssp EEEEE-----ETTTEEEEEETTSEEEEEETTTTCEEEEEE
T ss_pred ceEEEecceeCCCCEEEEEeCCCeEEEEECCCCeEEEEec
Confidence 3445555 67789999999999999999999977754
No 363
>COG3391 Uncharacterized conserved protein [Function unknown]
Probab=70.43 E-value=72 Score=40.76 Aligned_cols=136 Identities=13% Similarity=0.032 Sum_probs=87.4
Q ss_pred EEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC---CCcEEEe
Q 000080 2223 RAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL---DGTVCTW 2298 (2389)
Q Consensus 2223 rsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~---DgTVkLW 2298 (2389)
..++++++|+ .+++...+.+|++-|..+.+.+.+..+ |. .-..++|+|+|+.+-.+.. +++|.+-
T Consensus 77 ~~i~v~~~~~~vyv~~~~~~~v~vid~~~~~~~~~~~v---------G~--~P~~~~~~~~~~~vYV~n~~~~~~~vsvi 145 (381)
T COG3391 77 AGVAVNPAGNKVYVTTGDSNTVSVIDTATNTVLGSIPV---------GL--GPVGLAVDPDGKYVYVANAGNGNNTVSVI 145 (381)
T ss_pred cceeeCCCCCeEEEecCCCCeEEEEcCcccceeeEeee---------cc--CCceEEECCCCCEEEEEecccCCceEEEE
Confidence 3568899888 677777789999999877777766531 21 4578999999965555444 6888888
Q ss_pred eCCCCCccCccccee-eeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEE-----EEeecCcEEEE
Q 000080 2299 QLEVGGRSNVRPMES-CLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRAS-----ITCHEGLYDLF 2372 (2389)
Q Consensus 2299 Dl~tggrs~~k~l~t-l~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~s-----L~GH~~~V~sv 2372 (2389)
|-.+. +...+ ..|- .+ ..+++.| +|+.+..+- +.+++|-+-|+. +..+.. ...-...=.-+
T Consensus 146 d~~t~-----~~~~~~~vG~-~P-~~~a~~p-~g~~vyv~~--~~~~~v~vi~~~---~~~v~~~~~~~~~~~~~~P~~i 212 (381)
T COG3391 146 DAATN-----KVTATIPVGN-TP-TGVAVDP-DGNKVYVTN--SDDNTVSVIDTS---GNSVVRGSVGSLVGVGTGPAGI 212 (381)
T ss_pred eCCCC-----eEEEEEecCC-Cc-ceEEECC-CCCeEEEEe--cCCCeEEEEeCC---CcceeccccccccccCCCCceE
Confidence 87765 22322 2222 23 7899999 888555542 578999999962 222221 11111222467
Q ss_pred eecccchhhh
Q 000080 2373 LPLKLLNFAL 2382 (2389)
Q Consensus 2373 A~~~~~~~~~ 2382 (2389)
+..++|+++-
T Consensus 213 ~v~~~g~~~y 222 (381)
T COG3391 213 AVDPDGNRVY 222 (381)
T ss_pred EECCCCCEEE
Confidence 7777777653
No 364
>PF04053 Coatomer_WDAD: Coatomer WD associated region ; InterPro: IPR006692 Proteins synthesised on the ribosome and processed in the endoplasmic reticulum are transported from the Golgi apparatus to the trans-Golgi network (TGN), and from there via small carrier vesicles to their final destination compartment. This traffic is bidirectional, to ensure that proteins required to form vesicles are recycled. Vesicles have specific coat proteins (such as clathrin or coatomer) that are important for cargo selection and direction of transfer []. While clathrin mediates endocytic protein transport, and transport from ER to Golgi, coatomers primarily mediate intra-Golgi transport, as well as the reverse Golgi to ER transport of dilysine-tagged proteins []. For example, the coatomer COP1 (coat protein complex 1) is responsible for reverse transport of recycled proteins from Golgi and pre-Golgi compartments back to the ER, while COPII buds vesicles from the ER to the Golgi []. Coatomers reversibly associate with Golgi (non-clathrin-coated) vesicles to mediate protein transport and for budding from Golgi membranes []. Activated small guanine triphosphatases (GTPases) attract coat proteins to specific membrane export sites, thereby linking coatomers to export cargos. As coat proteins polymerise, vesicles are formed and budded from membrane-bound organelles. Coatomer complexes also influence Golgi structural integrity, as well as the processing, activity, and endocytic recycling of LDL receptors. In mammals, coatomer complexes can only be recruited by membranes associated to ADP-ribosylation factors (ARFs), which are small GTP-binding proteins. Coatomer complexes are hetero-oligomers composed of at least an alpha, beta, beta', gamma, delta, epsilon and zeta subunits. This entry represents the WD-associated region found in coatomer subunits alpha, beta and beta' subunits. The alpha-subunit (RET1P) of the coatomer complex in Saccharomyces cerevisiae (Baker's yeast), participates in membrane transport between the endoplasmic reticulum and Golgi apparatus. The protein contains six WD-40 repeat motifs in its N-terminal region []. More information about these proteins can be found at Protein of the Month: Clathrin [].; GO: 0005198 structural molecule activity, 0006886 intracellular protein transport, 0016192 vesicle-mediated transport, 0030117 membrane coat; PDB: 3MKQ_B.
Probab=68.76 E-value=9.2 Score=49.83 Aligned_cols=86 Identities=28% Similarity=0.299 Sum_probs=62.9
Q ss_pred HHHHHHHHHHHHHHHhccCCcchhHHHHHHhcchHHHHHHHhcccCCCchhHHhHhhcccChHHHHHHHHhhHHHHhhcc
Q 000080 1244 TQLRTRMEKLARLQYLKKKDPKDCALLYIALNRIQVLAGLFKISKDEKDKPLVGFLSRNFQEEKNKAAALKNAYVLLGRH 1323 (2389)
Q Consensus 1244 ~~Lr~~~EkIAr~ey~~~kDP~dcaLfYlAL~Kk~vL~gL~k~~~~~k~~~m~~FLsnDFse~RWr~AAlKNAyaLLsK~ 1323 (2389)
.+|++-==++|..-|++.+|.....|+|++.|.+.-|..|-+++...+ +.+..|
T Consensus 356 ~AL~~g~~~lAe~c~~k~~d~~~L~lLy~~~g~~~~L~kl~~~a~~~~-~~n~af------------------------- 409 (443)
T PF04053_consen 356 EALRQGNIELAEECYQKAKDFSGLLLLYSSTGDREKLSKLAKIAEERG-DINIAF------------------------- 409 (443)
T ss_dssp HHHHTTBHHHHHHHHHHCT-HHHHHHHHHHCT-HHHHHHHHHHHHHTT--HHHHH-------------------------
T ss_pred HHHHcCCHHHHHHHHHhhcCccccHHHHHHhCCHHHHHHHHHHHHHcc-CHHHHH-------------------------
Confidence 345544455999999999999999999999999999888887765322 223333
Q ss_pred hhHHHHHHHHhcCChhHHHHHHHHhcCChhhhhhhhhhh
Q 000080 1324 QLELAIAFFLLGGDAASAVTVCARNLGDVQLALVICRLV 1362 (2389)
Q Consensus 1324 Ry~~AAAFFLLAg~lkDAV~Vc~~~L~D~qLAi~IaRLy 1362 (2389)
.-+++-|+++++|+++.+- +-+++|.+.||-|
T Consensus 410 ------~~~~~lgd~~~cv~lL~~~-~~~~~A~~~A~ty 441 (443)
T PF04053_consen 410 ------QAALLLGDVEECVDLLIET-GRLPEAALFARTY 441 (443)
T ss_dssp ------HHHHHHT-HHHHHHHHHHT-T-HHHHHHHHHHT
T ss_pred ------HHHHHcCCHHHHHHHHHHc-CCchHHHHHHHhc
Confidence 3345558899999998876 9999999999988
No 365
>PF06977 SdiA-regulated: SdiA-regulated; InterPro: IPR009722 This entry represents a conserved region approximately 100 residues long within a number of hypothetical bacterial proteins that may be regulated by SdiA, a member of the LuxR family of transcriptional regulators []. Some proteins contain the IPR001258 from INTERPRO repeat.; PDB: 3QQZ_A.
Probab=67.59 E-value=60 Score=39.69 Aligned_cols=184 Identities=13% Similarity=0.125 Sum_probs=96.7
Q ss_pred cccccccccceeeccccc-cccccccccCCCCcC-----ceeEEE-----------EEEcCCCCeEEEEeCCCcEEEeec
Q 000080 2186 FGIPGYAGIGASALGWET-QDDFEDYVDPPATVE-----NISTRA-----------FSSHPLRPFFLVGSSNTHIYLWEF 2248 (2389)
Q Consensus 2186 ~~~~g~~~~~Asg~~~d~-~~~~~~~~d~~atv~-----ni~Vrs-----------VAFsPdG~~LASGS~DgTIRLWDl 2248 (2389)
.-+||-.+- +||+.|+. ...++...|.+..+- +--++. |++--++.++++--.++++.+.++
T Consensus 15 ~~l~g~~~e-~SGLTy~pd~~tLfaV~d~~~~i~els~~G~vlr~i~l~g~~D~EgI~y~g~~~~vl~~Er~~~L~~~~~ 93 (248)
T PF06977_consen 15 KPLPGILDE-LSGLTYNPDTGTLFAVQDEPGEIYELSLDGKVLRRIPLDGFGDYEGITYLGNGRYVLSEERDQRLYIFTI 93 (248)
T ss_dssp EE-TT--S--EEEEEEETTTTEEEEEETTTTEEEEEETT--EEEEEE-SS-SSEEEEEE-STTEEEEEETTTTEEEEEEE
T ss_pred eECCCccCC-ccccEEcCCCCeEEEEECCCCEEEEEcCCCCEEEEEeCCCCCCceeEEEECCCEEEEEEcCCCcEEEEEE
Confidence 345555553 78888874 566777766555421 111344 455556767776546899999998
Q ss_pred CCCc---ee---eEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC--CCccC----cccceeeee
Q 000080 2249 GKDK---AT---ATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV--GGRSN----VRPMESCLC 2316 (2389)
Q Consensus 2249 ~tGk---~l---~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t--ggrs~----~k~l~tl~g 2316 (2389)
.... .. +.+.. + .+ ..+...+-.|+++|.+++|..+-...-.+|+.++. +.... ...+.....
T Consensus 94 ~~~~~~~~~~~~~~~~l--~--~~-~~~N~G~EGla~D~~~~~L~v~kE~~P~~l~~~~~~~~~~~~~~~~~~~~~~~~~ 168 (248)
T PF06977_consen 94 DDDTTSLDRADVQKISL--G--FP-NKGNKGFEGLAYDPKTNRLFVAKERKPKRLYEVNGFPGGFDLFVSDDQDLDDDKL 168 (248)
T ss_dssp ----TT--EEEEEEEE-------S----SS--EEEEEETTTTEEEEEEESSSEEEEEEESTT-SS--EEEE-HHHH-HT-
T ss_pred eccccccchhhceEEec--c--cc-cCCCcceEEEEEcCCCCEEEEEeCCCChhhEEEccccCccceeeccccccccccc
Confidence 4322 11 22220 0 01 12335699999999999999999988888887764 11000 001111112
Q ss_pred cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCce--EEEEeec-------CcEEEEeecccchhh
Q 000080 2317 FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSR--ASITCHE-------GLYDLFLPLKLLNFA 2381 (2389)
Q Consensus 2317 Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v--~sL~GH~-------~~V~svA~~~~~~~~ 2381 (2389)
+....++++|.|.+|++++-+ ...+.|-..|. .|+.+ ..|..-. .+.=-||+.++|+--
T Consensus 169 ~~~d~S~l~~~p~t~~lliLS---~es~~l~~~d~---~G~~~~~~~L~~g~~gl~~~~~QpEGIa~d~~G~LY 236 (248)
T PF06977_consen 169 FVRDLSGLSYDPRTGHLLILS---DESRLLLELDR---QGRVVSSLSLDRGFHGLSKDIPQPEGIAFDPDGNLY 236 (248)
T ss_dssp -SS---EEEEETTTTEEEEEE---TTTTEEEEE-T---T--EEEEEE-STTGGG-SS---SEEEEEE-TT--EE
T ss_pred eeccccceEEcCCCCeEEEEE---CCCCeEEEECC---CCCEEEEEEeCCcccCcccccCCccEEEECCCCCEE
Confidence 445678999999999988874 58899999994 56554 3443311 235588899988743
No 366
>KOG1008 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=66.92 E-value=2.7 Score=55.61 Aligned_cols=112 Identities=14% Similarity=0.290 Sum_probs=77.7
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECC-CCCEEEEEeCCCcEEEeeCC
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDH-YGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSP-DG~~LASgS~DgTVkLWDl~ 2301 (2389)
.++++-.|.+++++|..-..|+++|++..- .+.-.+ .+..|..+..+| .++++++-+ ||.|.+||..
T Consensus 158 ns~cwlrd~klvlaGm~sr~~~ifdlRqs~-~~~~sv----------nTk~vqG~tVdp~~~nY~cs~~-dg~iAiwD~~ 225 (783)
T KOG1008|consen 158 NSVCWLRDTKLVLAGMTSRSVHIFDLRQSL-DSVSSV----------NTKYVQGITVDPFSPNYFCSNS-DGDIAIWDTY 225 (783)
T ss_pred cccccccCcchhhcccccchhhhhhhhhhh-hhhhhh----------hhhhcccceecCCCCCceeccc-cCceeeccch
Confidence 467888899999999999999999997332 111110 124578888999 789999888 9999999943
Q ss_pred CCCccCcccceeeeecCC----CeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2302 VGGRSNVRPMESCLCFSS----HAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2302 tggrs~~k~l~tl~gHs~----~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
.. ...++.+.+--.. .+..++|.|-.-.+||+- .-+.+||++.|+
T Consensus 226 rn---ienpl~~i~~~~N~~~~~l~~~aycPtrtglla~l--~RdS~tIrlydi 274 (783)
T KOG1008|consen 226 RN---IENPLQIILRNENKKPKQLFALAYCPTRTGLLAVL--SRDSITIRLYDI 274 (783)
T ss_pred hh---hccHHHHHhhCCCCcccceeeEEeccCCcchhhhh--ccCcceEEEecc
Confidence 21 1135544442222 388899998533455553 246689999997
No 367
>KOG3621 consensus WD40 repeat-containing protein [General function prediction only]
Probab=66.71 E-value=12 Score=50.49 Aligned_cols=108 Identities=15% Similarity=0.247 Sum_probs=76.0
Q ss_pred EEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCC
Q 000080 2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus 2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~ 2301 (2389)
+..++.|++..++|.|++.|.|-++.+..+....-..+-+.|. -|...|+++++|+||.++-+|..-|+|-+=-+.
T Consensus 79 ~~~~~vs~~e~lvAagt~~g~V~v~ql~~~~p~~~~~~t~~d~----~~~~rVTal~Ws~~~~k~ysGD~~Gkv~~~~L~ 154 (726)
T KOG3621|consen 79 TCVRSVSSVEYLVAAGTASGRVSVFQLNKELPRDLDYVTPCDK----SHKCRVTALEWSKNGMKLYSGDSQGKVVLTELD 154 (726)
T ss_pred EEEEEecchhHhhhhhcCCceEEeehhhccCCCcceeeccccc----cCCceEEEEEecccccEEeecCCCceEEEEEec
Confidence 4667899999999999999999999987654322212234442 367899999999999999999999999998777
Q ss_pred CCCccCcccceeeeecCCCeeEEEEecCCCCEEEE
Q 000080 2302 VGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAA 2336 (2389)
Q Consensus 2302 tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLAS 2336 (2389)
+. ....-+...+.-..+.|-.+.+.. +.+|++
T Consensus 155 s~-~~~~~~~q~il~~ds~IVQlD~~q--~~LLVS 186 (726)
T KOG3621|consen 155 SR-QAFLSKSQEILSEDSEIVQLDYLQ--SYLLVS 186 (726)
T ss_pred hh-hhhccccceeeccCcceEEeeccc--ceehHh
Confidence 61 001112233333456777777764 455554
No 368
>KOG1008 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=66.17 E-value=2.1 Score=56.46 Aligned_cols=139 Identities=9% Similarity=0.067 Sum_probs=84.9
Q ss_pred EEEEEcCC-CCeEEEEe----CCCcEEEeecCCCc--eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcE
Q 000080 2223 RAFSSHPL-RPFFLVGS----SNTHIYLWEFGKDK--ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTV 2295 (2389)
Q Consensus 2223 rsVAFsPd-G~~LASGS----~DgTIRLWDl~tGk--~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTV 2295 (2389)
.++||++- ...||.|= .|..++|||+.++- ...+.. +. .+-...+.+|++--|-+++.+|..-+.|
T Consensus 106 t~lAwneLDtn~LAagldkhrnds~~~Iwdi~s~ltvPke~~~------fs-~~~l~gqns~cwlrd~klvlaGm~sr~~ 178 (783)
T KOG1008|consen 106 TSLAWNELDTNHLAAGLDKHRNDSSLKIWDINSLLTVPKESPL------FS-SSTLDGQNSVCWLRDTKLVLAGMTSRSV 178 (783)
T ss_pred cccccccccHHHHHhhhhhhcccCCccceecccccCCCccccc------cc-cccccCccccccccCcchhhcccccchh
Confidence 45677774 45666553 56789999998762 111111 00 1123556788888888999999999999
Q ss_pred EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCc----EEE
Q 000080 2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGL----YDL 2371 (2389)
Q Consensus 2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~----V~s 2371 (2389)
++.|++.. +.+. . .--+..|..++..|-.+.++++ ..|+.|-+||+...-.+.++++...++. +..
T Consensus 179 ~ifdlRqs---~~~~-~--svnTk~vqG~tVdp~~~nY~cs----~~dg~iAiwD~~rnienpl~~i~~~~N~~~~~l~~ 248 (783)
T KOG1008|consen 179 HIFDLRQS---LDSV-S--SVNTKYVQGITVDPFSPNYFCS----NSDGDIAIWDTYRNIENPLQIILRNENKKPKQLFA 248 (783)
T ss_pred hhhhhhhh---hhhh-h--hhhhhhcccceecCCCCCceec----cccCceeeccchhhhccHHHHHhhCCCCcccceee
Confidence 99999842 1011 0 1122355567777767789987 4699999999521112234444434443 666
Q ss_pred Eeecccc
Q 000080 2372 FLPLKLL 2378 (2389)
Q Consensus 2372 vA~~~~~ 2378 (2389)
+|..|--
T Consensus 249 ~aycPtr 255 (783)
T KOG1008|consen 249 LAYCPTR 255 (783)
T ss_pred EEeccCC
Confidence 6665543
No 369
>KOG4640 consensus Anaphase-promoting complex (APC), subunit 4 [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=65.25 E-value=19 Score=48.27 Aligned_cols=78 Identities=12% Similarity=0.163 Sum_probs=57.9
Q ss_pred CCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCee-EEEEecCCCCEEEEeecCCCCCeEEEee
Q 000080 2272 ASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAM-DVSYITSSGSVIAAAGHSSNGINVVVWD 2350 (2389)
Q Consensus 2272 ~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~-sVAFSP~DGslLASAG~sS~D~TVrLWD 2350 (2389)
..|.-+-++|.=..||.+..+|-|-+-.++- +.+.+..-|.-.|. +++|.| ||++||. |+ .||+|+|-|
T Consensus 21 ~~i~~~ewnP~~dLiA~~t~~gelli~R~n~------qRlwtip~p~~~v~~sL~W~~-DGkllaV-g~--kdG~I~L~D 90 (665)
T KOG4640|consen 21 INIKRIEWNPKMDLIATRTEKGELLIHRLNW------QRLWTIPIPGENVTASLCWRP-DGKLLAV-GF--KDGTIRLHD 90 (665)
T ss_pred cceEEEEEcCccchhheeccCCcEEEEEecc------ceeEeccCCCCccceeeeecC-CCCEEEE-Ee--cCCeEEEEE
Confidence 3478889999999999999999886665552 23444443444555 899999 9999997 44 789999999
Q ss_pred CCCCCCCceEE
Q 000080 2351 TLAPPTSSRAS 2361 (2389)
Q Consensus 2351 ~l~~tg~~v~s 2361 (2389)
+ ..+..++.
T Consensus 91 v--e~~~~l~~ 99 (665)
T KOG4640|consen 91 V--EKGGRLVS 99 (665)
T ss_pred c--cCCCceec
Confidence 8 34555544
No 370
>PF00930 DPPIV_N: Dipeptidyl peptidase IV (DPP IV) N-terminal region; InterPro: IPR002469 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This domain defines serine peptidases belonging to MEROPS peptidase family S9 (clan SC), subfamily S9B (dipeptidyl-peptidase IV). The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. This domain is an alignment of the region to the N-terminal side of the active site, which is found in IPR001375 from INTERPRO. CD26 (3.4.14.5 from EC) is also called adenosine deaminase-binding protein (ADA-binding protein) or dipeptidylpeptidase IV (DPP IV ectoenzyme). The exopeptidase cleaves off N-terminal X-Pro or X-Ala dipeptides from polypeptides (dipeptidyl peptidase IV activity). CD26 serves as the costimulatory molecule in T cell activation and is an associated marker of autoimmune diseases, adenosine deaminase-deficiency and HIV pathogenesis. Dipeptidyl peptidase IV (DPP IV) is responsible for the removal of N-terminal dipeptides sequentially from polypeptides having unsubstituted N termini, provided that the penultimate residue is proline. The enzyme catalyses the reaction: Dipeptidyl-Polypeptide + H(2)O = Dipeptide + Polypeptide It is a type II membrane protein that forms a homodimer. CD molecules are leucocyte antigens on cell surfaces. CD antigens nomenclature is updated at Protein Reviews On The Web (http://prow.nci.nih.gov/). ; GO: 0006508 proteolysis, 0016020 membrane; PDB: 2RIP_A 3Q8W_B 2AJL_I 1TKR_B 1TK3_B 3C45_A 2G5P_A 3G0C_D 1R9M_C 1RWQ_A ....
Probab=65.12 E-value=50 Score=41.41 Aligned_cols=155 Identities=8% Similarity=0.021 Sum_probs=90.8
Q ss_pred eEEEEEEcCCCC-eEE-EEeCC---CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEEC-CCCCEEE-EEeCCC
Q 000080 2221 STRAFSSHPLRP-FFL-VGSSN---THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFD-HYGHRFA-SAALDG 2293 (2389)
Q Consensus 2221 ~VrsVAFsPdG~-~LA-SGS~D---gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFS-PDG~~LA-SgS~Dg 2293 (2389)
.+..+.|.++++ +++ .-+.+ ..+.+.|..+|++...++... .|-...-....|. ++|..++ ....||
T Consensus 185 yl~~v~W~~d~~~l~~~~~nR~q~~~~l~~~d~~tg~~~~~~~e~~------~~Wv~~~~~~~~~~~~~~~~l~~s~~~G 258 (353)
T PF00930_consen 185 YLTRVGWSPDGKRLWVQWLNRDQNRLDLVLCDASTGETRVVLEETS------DGWVDVYDPPHFLGPDGNEFLWISERDG 258 (353)
T ss_dssp EEEEEEEEETTEEEEEEEEETTSTEEEEEEEEECTTTCEEEEEEES------SSSSSSSSEEEE-TTTSSEEEEEEETTS
T ss_pred CcccceecCCCcEEEEEEcccCCCEEEEEEEECCCCceeEEEEecC------CcceeeecccccccCCCCEEEEEEEcCC
Confidence 458899999999 333 33333 346788988887654443211 1222333466665 7776444 444677
Q ss_pred cEEEeeCCCCCccCcccceeeeecCCCeeE-EEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEE
Q 000080 2294 TVCTWQLEVGGRSNVRPMESCLCFSSHAMD-VSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLF 2372 (2389)
Q Consensus 2294 TVkLWDl~tggrs~~k~l~tl~gHs~~V~s-VAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~sv 2372 (2389)
--.|+-+...+ .....++...-.|.+ +.+.+ +++.|.-.+....-..-.||-+....+..+++|.+..+.-..+
T Consensus 259 ~~hly~~~~~~----~~~~~lT~G~~~V~~i~~~d~-~~~~iyf~a~~~~p~~r~lY~v~~~~~~~~~~LT~~~~~~~~~ 333 (353)
T PF00930_consen 259 YRHLYLYDLDG----GKPRQLTSGDWEVTSILGWDE-DNNRIYFTANGDNPGERHLYRVSLDSGGEPKCLTCEDGDHYSA 333 (353)
T ss_dssp SEEEEEEETTS----SEEEESS-SSS-EEEEEEEEC-TSSEEEEEESSGGTTSBEEEEEETTETTEEEESSTTSSTTEEE
T ss_pred CcEEEEEcccc----cceeccccCceeecccceEcC-CCCEEEEEecCCCCCceEEEEEEeCCCCCeEeccCCCCCceEE
Confidence 77777555432 123345545566755 66777 5555543321112235567776433255678888777666899
Q ss_pred eecccchhhhcccc
Q 000080 2373 LPLKLLNFALSKCR 2386 (2389)
Q Consensus 2373 A~~~~~~~~~s~~~ 2386 (2389)
++||+|++++-.|.
T Consensus 334 ~~Spdg~y~v~~~s 347 (353)
T PF00930_consen 334 SFSPDGKYYVDTYS 347 (353)
T ss_dssp EE-TTSSEEEEEEE
T ss_pred EECCCCCEEEEEEc
Confidence 99999999998875
No 371
>COG3386 Gluconolactonase [Carbohydrate transport and metabolism]
Probab=61.13 E-value=1.4e+02 Score=37.75 Aligned_cols=135 Identities=13% Similarity=0.033 Sum_probs=72.9
Q ss_pred EEEEEcCCCCeEEEEeC-----------CCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC
Q 000080 2223 RAFSSHPLRPFFLVGSS-----------NTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL 2291 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~-----------DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~ 2291 (2389)
..+..+|+|.+.++... -|.|+-.|. .|..++-+. + |...=+.|+|||||++|-.+..
T Consensus 114 ND~~v~pdG~~wfgt~~~~~~~~~~~~~~G~lyr~~p-~g~~~~l~~---~-------~~~~~NGla~SpDg~tly~aDT 182 (307)
T COG3386 114 NDGVVDPDGRIWFGDMGYFDLGKSEERPTGSLYRVDP-DGGVVRLLD---D-------DLTIPNGLAFSPDGKTLYVADT 182 (307)
T ss_pred CceeEcCCCCEEEeCCCccccCccccCCcceEEEEcC-CCCEEEeec---C-------cEEecCceEECCCCCEEEEEeC
Confidence 44579999998887554 122333332 344333221 1 2233477999999987777766
Q ss_pred C-CcEEEeeCC-CCCc-cCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCc
Q 000080 2292 D-GTVCTWQLE-VGGR-SNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGL 2368 (2389)
Q Consensus 2292 D-gTVkLWDl~-tggr-s~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~ 2368 (2389)
. +.|.-+++. ..+. .+.+...-...+.+..-.++.-. +|.+-+++. ...+-|..|+. +++.++.+.-....
T Consensus 183 ~~~~i~r~~~d~~~g~~~~~~~~~~~~~~~G~PDG~~vDa-dG~lw~~a~--~~g~~v~~~~p---dG~l~~~i~lP~~~ 256 (307)
T COG3386 183 PANRIHRYDLDPATGPIGGRRGFVDFDEEPGLPDGMAVDA-DGNLWVAAV--WGGGRVVRFNP---DGKLLGEIKLPVKR 256 (307)
T ss_pred CCCeEEEEecCcccCccCCcceEEEccCCCCCCCceEEeC-CCCEEEecc--cCCceEEEECC---CCcEEEEEECCCCC
Confidence 4 777777665 2111 01111222222334444566665 777665432 12236777774 56666666655455
Q ss_pred EEEEee
Q 000080 2369 YDLFLP 2374 (2389)
Q Consensus 2369 V~svA~ 2374 (2389)
++++++
T Consensus 257 ~t~~~F 262 (307)
T COG3386 257 PTNPAF 262 (307)
T ss_pred CccceE
Confidence 554444
No 372
>PF08596 Lgl_C: Lethal giant larvae(Lgl) like, C-terminal; InterPro: IPR013905 The Lethal giant larvae (Lgl) tumour suppressor protein is conserved from yeast to mammals. The Lgl protein functions in cell polarity, at least in part, by regulating SNARE-mediated membrane delivery events at the cell surface []. The N-terminal half of Lgl members contains WD40 repeats (see IPR001680 from INTERPRO), while the C-terminal half appears specific to the protein []. ; PDB: 2OAJ_A.
Probab=60.41 E-value=1.1e+02 Score=39.81 Aligned_cols=147 Identities=19% Similarity=0.264 Sum_probs=79.3
Q ss_pred ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceee------Eec----cc-----C------CCCCC-----------
Q 000080 2219 NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATA------TYG----VL-----P------AANVP----------- 2266 (2389)
Q Consensus 2219 ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~------Tl~----vl-----~------gh~~p----------- 2266 (2389)
|+.|..|+|.++...||.|-..|.|-||-++..+.-. .+. .+ + -|..+
T Consensus 1 ~~~v~~vs~a~~t~Elav~~~~GeVv~~k~~~n~~~~~~~~~~~~~~~~~~~~~~~~~~~l~di~~r~~~~~~~gf~P~~ 80 (395)
T PF08596_consen 1 NVSVTHVSFAPETLELAVGLESGEVVLFKFGKNQNYGNREQPPDLDYNFRRFSLNNSPGKLTDISDRAPPSLKEGFLPLT 80 (395)
T ss_dssp ---EEEEEEETTTTEEEEEETTS-EEEEEEEE------------------S--GGGSS-SEEE-GGG--TT-SEEEEEEE
T ss_pred CceEEEEEecCCCceEEEEccCCcEEEEEcccCCCCCccCCCcccCcccccccccCCCcceEEehhhCCcccccccCchh
Confidence 4678999999999999999999999999886443211 000 00 0 00000
Q ss_pred --CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCccccee--eee------cCCCeeEEEEe----cCCC-
Q 000080 2267 --PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMES--CLC------FSSHAMDVSYI----TSSG- 2331 (2389)
Q Consensus 2267 --~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~t--l~g------Hs~~V~sVAFS----P~DG- 2331 (2389)
.. ..+.|++++.|-=| ++|.|..||++.+-|++.. ..+++ +.. .+..|.++.|+ -+|+
T Consensus 81 l~~~-~~g~vtal~~S~iG-Fvaigy~~G~l~viD~RGP-----avI~~~~i~~~~~~~~~~~~vt~ieF~vm~~~~D~y 153 (395)
T PF08596_consen 81 LLDA-KQGPVTALKNSDIG-FVAIGYESGSLVVIDLRGP-----AVIYNENIRESFLSKSSSSYVTSIEFSVMTLGGDGY 153 (395)
T ss_dssp EE----S-SEEEEEE-BTS-EEEEEETTSEEEEEETTTT-----EEEEEEEGGG--T-SS----EEEEEEEEEE-TTSSS
T ss_pred heec-cCCcEeEEecCCCc-EEEEEecCCcEEEEECCCC-----eEEeeccccccccccccccCeeEEEEEEEecCCCcc
Confidence 12 24789999998556 9999999999999999743 22222 111 23456677776 2233
Q ss_pred --CEEEEeecCCCCCeEEEeeCCC-CCCCceEEEE----eecCcEEEEeec
Q 000080 2332 --SVIAAAGHSSNGINVVVWDTLA-PPTSSRASIT----CHEGLYDLFLPL 2375 (2389)
Q Consensus 2332 --slLASAG~sS~D~TVrLWD~l~-~tg~~v~sL~----GH~~~V~svA~~ 2375 (2389)
-+|.. | .+.|++.++.++- +.+.....+. .|.+.|..+.+.
T Consensus 154 SSi~L~v-G--Tn~G~v~~fkIlp~~~g~f~v~~~~~~~~~~~~i~~I~~i 201 (395)
T PF08596_consen 154 SSICLLV-G--TNSGNVLTFKILPSSNGRFSVQFAGATTNHDSPILSIIPI 201 (395)
T ss_dssp EEEEEEE-E--ETTSEEEEEEEEE-GGG-EEEEEEEEE--SS----EEEEE
T ss_pred cceEEEE-E--eCCCCEEEEEEecCCCCceEEEEeeccccCCCceEEEEEE
Confidence 24443 4 4669999998852 2222222332 355777777765
No 373
>PF04053 Coatomer_WDAD: Coatomer WD associated region ; InterPro: IPR006692 Proteins synthesised on the ribosome and processed in the endoplasmic reticulum are transported from the Golgi apparatus to the trans-Golgi network (TGN), and from there via small carrier vesicles to their final destination compartment. This traffic is bidirectional, to ensure that proteins required to form vesicles are recycled. Vesicles have specific coat proteins (such as clathrin or coatomer) that are important for cargo selection and direction of transfer []. While clathrin mediates endocytic protein transport, and transport from ER to Golgi, coatomers primarily mediate intra-Golgi transport, as well as the reverse Golgi to ER transport of dilysine-tagged proteins []. For example, the coatomer COP1 (coat protein complex 1) is responsible for reverse transport of recycled proteins from Golgi and pre-Golgi compartments back to the ER, while COPII buds vesicles from the ER to the Golgi []. Coatomers reversibly associate with Golgi (non-clathrin-coated) vesicles to mediate protein transport and for budding from Golgi membranes []. Activated small guanine triphosphatases (GTPases) attract coat proteins to specific membrane export sites, thereby linking coatomers to export cargos. As coat proteins polymerise, vesicles are formed and budded from membrane-bound organelles. Coatomer complexes also influence Golgi structural integrity, as well as the processing, activity, and endocytic recycling of LDL receptors. In mammals, coatomer complexes can only be recruited by membranes associated to ADP-ribosylation factors (ARFs), which are small GTP-binding proteins. Coatomer complexes are hetero-oligomers composed of at least an alpha, beta, beta', gamma, delta, epsilon and zeta subunits. This entry represents the WD-associated region found in coatomer subunits alpha, beta and beta' subunits. The alpha-subunit (RET1P) of the coatomer complex in Saccharomyces cerevisiae (Baker's yeast), participates in membrane transport between the endoplasmic reticulum and Golgi apparatus. The protein contains six WD-40 repeat motifs in its N-terminal region []. More information about these proteins can be found at Protein of the Month: Clathrin [].; GO: 0005198 structural molecule activity, 0006886 intracellular protein transport, 0016192 vesicle-mediated transport, 0030117 membrane coat; PDB: 3MKQ_B.
Probab=59.08 E-value=51 Score=43.28 Aligned_cols=99 Identities=17% Similarity=0.290 Sum_probs=54.5
Q ss_pred EEEEcCCCCeEEEEeCCCcEEEe-ecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080 2224 AFSSHPLRPFFLVGSSNTHIYLW-EFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus 2224 sVAFsPdG~~LASGS~DgTIRLW-Dl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
..+|++.++ +|.-...++|+++ ++ +.+.+..++. + ..+..|-. |..|+..+.+ .|.+||+++
T Consensus 73 ~~vw~~~n~-yAv~~~~~~I~I~kn~-~~~~~k~i~~--------~---~~~~~If~---G~LL~~~~~~-~i~~yDw~~ 135 (443)
T PF04053_consen 73 SFVWSSRNR-YAVLESSSTIKIYKNF-KNEVVKSIKL--------P---FSVEKIFG---GNLLGVKSSD-FICFYDWET 135 (443)
T ss_dssp EEEE-TSSE-EEEE-TTS-EEEEETT-EE-TT-------------S---S-EEEEE----SSSEEEEETT-EEEEE-TTT
T ss_pred EEEEecCcc-EEEEECCCeEEEEEcC-ccccceEEcC--------C---cccceEEc---CcEEEEECCC-CEEEEEhhH
Confidence 456777554 4444457778885 44 2222233321 1 12444444 8888888776 899999998
Q ss_pred CCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2303 GGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2303 ggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
+ +.+..... ..|..|.|++ +|+++|-. .+.++.|.+.
T Consensus 136 ~-----~~i~~i~v--~~vk~V~Ws~-~g~~val~----t~~~i~il~~ 172 (443)
T PF04053_consen 136 G-----KLIRRIDV--SAVKYVIWSD-DGELVALV----TKDSIYILKY 172 (443)
T ss_dssp -------EEEEESS---E-EEEEE-T-TSSEEEEE-----S-SEEEEEE
T ss_pred c-----ceeeEEec--CCCcEEEEEC-CCCEEEEE----eCCeEEEEEe
Confidence 6 35555542 2378999999 89999986 3557888886
No 374
>smart00299 CLH Clathrin heavy chain repeat homology.
Probab=58.29 E-value=22 Score=38.41 Aligned_cols=60 Identities=18% Similarity=0.180 Sum_probs=43.9
Q ss_pred hhHHhHhhc---ccChHHHHHHHHhhHHHHhhcchhHHHHHHHHh--cCChhHHHHHHHHhcCChhhhhhhhhh
Q 000080 1293 KPLVGFLSR---NFQEEKNKAAALKNAYVLLGRHQLELAIAFFLL--GGDAASAVTVCARNLGDVQLALVICRL 1361 (2389)
Q Consensus 1293 ~~m~~FLsn---DFse~RWr~AAlKNAyaLLsK~Ry~~AAAFFLL--Ag~lkDAV~Vc~~~L~D~qLAi~IaRL 1361 (2389)
.++.+||.+ .|+-+ .|..+..++++. .+++||+ .|..++||++++++++|+++|+-.|+-
T Consensus 57 ~~ll~~l~~~~~~yd~~--------~~~~~c~~~~l~-~~~~~l~~k~~~~~~Al~~~l~~~~d~~~a~~~~~~ 121 (140)
T smart00299 57 QKEIERLDNKSNHYDIE--------KVGKLCEKAKLY-EEAVELYKKDGNFKDAIVTLIEHLGNYEKAIEYFVK 121 (140)
T ss_pred HHHHHHHHhccccCCHH--------HHHHHHHHcCcH-HHHHHHHHhhcCHHHHHHHHHHcccCHHHHHHHHHh
Confidence 457888883 44433 466777777664 3444444 367899999999999999999988875
No 375
>TIGR02604 Piru_Ver_Nterm putative membrane-bound dehydrogenase domain. All proteins that score above the trusted cutoff score of 45 to this model are large proteins of either Pirellula sp. 1 or Verrucomicrobium spinosum. These proteins all contain, in addition to this domain, several hundred residues of highly variable sequence, and then a well-conserved C-terminal domain (TIGR02603) that features a putative cytochrome c-type heme binding motif CXXCH. The membrane-bound L-sorbosone dehydrogenase from Acetobacter liquefaciens (Gluconacetobacter liquefaciens) is homologous to this domain but lacks additional sequence regions shared by members of this family and belongs to a different clade of the larger family of homologs. It and its closely related homologs are excluded from the this model by scoring between the trusted (45) and noise (18) cutoffs.
Probab=58.23 E-value=80 Score=40.01 Aligned_cols=101 Identities=11% Similarity=0.138 Sum_probs=55.1
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCC-C----ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC-----
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGK-D----KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD----- 2292 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~t-G----k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D----- 2292 (2389)
+.+++.++| ++++ +.+.-.++.|... + +....+..++... ..+......++|.|||+..++-+..
T Consensus 75 ~Gi~~~~~G-lyV~-~~~~i~~~~d~~gdg~ad~~~~~l~~~~~~~~---~~~~~~~~~l~~gpDG~LYv~~G~~~~~~~ 149 (367)
T TIGR02604 75 TGLAVAVGG-VYVA-TPPDILFLRDKDGDDKADGEREVLLSGFGGQI---NNHHHSLNSLAWGPDGWLYFNHGNTLASKV 149 (367)
T ss_pred cceeEecCC-EEEe-CCCeEEEEeCCCCCCCCCCccEEEEEccCCCC---CcccccccCceECCCCCEEEecccCCCcee
Confidence 567999999 6664 4454444556532 1 2111122222210 1123568899999999987765521
Q ss_pred --------------CcEEEeeCCCCCccCcccceee-eecCCCeeEEEEecCCCCEEEE
Q 000080 2293 --------------GTVCTWQLEVGGRSNVRPMESC-LCFSSHAMDVSYITSSGSVIAA 2336 (2389)
Q Consensus 2293 --------------gTVkLWDl~tggrs~~k~l~tl-~gHs~~V~sVAFSP~DGslLAS 2336 (2389)
|.|.-.|..++ .+..+ .|+ ...+.++|+| +|+++++
T Consensus 150 ~~~~~~~~~~~~~~g~i~r~~pdg~------~~e~~a~G~-rnp~Gl~~d~-~G~l~~t 200 (367)
T TIGR02604 150 TRPGTSDESRQGLGGGLFRYNPDGG------KLRVVAHGF-QNPYGHSVDS-WGDVFFC 200 (367)
T ss_pred ccCCCccCcccccCceEEEEecCCC------eEEEEecCc-CCCccceECC-CCCEEEE
Confidence 33333344332 11121 233 3346899999 8999876
No 376
>COG3490 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=57.97 E-value=87 Score=39.27 Aligned_cols=102 Identities=12% Similarity=0.145 Sum_probs=70.3
Q ss_pred EEEEEcCCCCe-EEEEeCCCc-EEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC-----CcE
Q 000080 2223 RAFSSHPLRPF-FLVGSSNTH-IYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD-----GTV 2295 (2389)
Q Consensus 2223 rsVAFsPdG~~-LASGS~DgT-IRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D-----gTV 2295 (2389)
..|+|||..+. ++-+-.=|| ..++|..++++..++...++- ..-|| . .|||||.+|-..-.| |.|
T Consensus 71 Hgi~~~p~~~ravafARrPGtf~~vfD~~~~~~pv~~~s~~~R--HfyGH--G----vfs~dG~~LYATEndfd~~rGVi 142 (366)
T COG3490 71 HGIAFHPALPRAVAFARRPGTFAMVFDPNGAQEPVTLVSQEGR--HFYGH--G----VFSPDGRLLYATENDFDPNRGVI 142 (366)
T ss_pred CCeecCCCCcceEEEEecCCceEEEECCCCCcCcEEEecccCc--eeecc--c----ccCCCCcEEEeecCCCCCCCceE
Confidence 44589998774 555555555 589999888877776321111 11233 2 499999988877665 889
Q ss_pred EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEe
Q 000080 2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAA 2337 (2389)
Q Consensus 2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASA 2337 (2389)
-++|.+.+ .+.+-.+..|.-.--+|.+.+ ||++|+.+
T Consensus 143 GvYd~r~~----fqrvgE~~t~GiGpHev~lm~-DGrtlvva 179 (366)
T COG3490 143 GVYDAREG----FQRVGEFSTHGIGPHEVTLMA-DGRTLVVA 179 (366)
T ss_pred EEEecccc----cceecccccCCcCcceeEEec-CCcEEEEe
Confidence 99999853 134455666766666899999 99999976
No 377
>PF14870 PSII_BNR: Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=56.72 E-value=1.3e+02 Score=37.80 Aligned_cols=105 Identities=18% Similarity=0.240 Sum_probs=55.3
Q ss_pred CCeeEEEEcCCCCCCCcEEEecCCeEEEEeeCCCCCCCCccceeeEEec--ccceEEEEeecCCCCeEEEEecceEEee-
Q 000080 95 LPVTSISWSPETPSIGQLAAASENCIFVFAHDSASSKGSFCWSQNAILV--QGTKVEAIEWTGSGDGIVAGGMETVLWK- 171 (2389)
Q Consensus 95 ~dVk~VaWSPd~~~~GeIaASyDntIRVw~~d~~~~kgd~~W~~~~tL~--hssTV~sIAWSpdG~rLaSggdDV~IW~- 171 (2389)
.+|..+.|.|+ ++-++++-++.|+.=... .....|.....-. ..-.+-+++|.+++.-.|+||.+..+-.
T Consensus 187 ~riq~~gf~~~---~~lw~~~~Gg~~~~s~~~----~~~~~w~~~~~~~~~~~~~~ld~a~~~~~~~wa~gg~G~l~~S~ 259 (302)
T PF14870_consen 187 RRIQSMGFSPD---GNLWMLARGGQIQFSDDP----DDGETWSEPIIPIKTNGYGILDLAYRPPNEIWAVGGSGTLLVST 259 (302)
T ss_dssp S-EEEEEE-TT---S-EEEEETTTEEEEEE-T----TEEEEE---B-TTSS--S-EEEEEESSSS-EEEEESTT-EEEES
T ss_pred ceehhceecCC---CCEEEEeCCcEEEEccCC----CCccccccccCCcccCceeeEEEEecCCCCEEEEeCCccEEEeC
Confidence 58999999997 555566666666655411 0122566632221 2335899999999998898888733332
Q ss_pred ccCCcEEEEEEeeccccceEEEEeecCCCc-eEeeec
Q 000080 172 KKNTLWEIAWKFKENYPQNLVSATWSIEGP-SATAAS 207 (2389)
Q Consensus 172 ~~~s~Wecvwt~~~~~~~~ivsvaWSpdG~-fATag~ 207 (2389)
.+...|+..=. -...|.++|.+.+..+.+ ||-+..
T Consensus 260 DgGktW~~~~~-~~~~~~n~~~i~f~~~~~gf~lG~~ 295 (302)
T PF14870_consen 260 DGGKTWQKDRV-GENVPSNLYRIVFVNPDKGFVLGQD 295 (302)
T ss_dssp STTSS-EE-GG-GTTSSS---EEEEEETTEEEEE-ST
T ss_pred CCCccceECcc-ccCCCCceEEEEEcCCCceEEECCC
Confidence 46677996510 113466899888877666 775533
No 378
>KOG0882 consensus Cyclophilin-related peptidyl-prolyl cis-trans isomerase [Posttranslational modification, protein turnover, chaperones]
Probab=56.17 E-value=39 Score=43.95 Aligned_cols=117 Identities=12% Similarity=0.115 Sum_probs=78.1
Q ss_pred eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC-C----CccC
Q 000080 2233 FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV-G----GRSN 2307 (2389)
Q Consensus 2233 ~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t-g----grs~ 2307 (2389)
+-++.-.++.|-+.|-.-+-|-..+. . .-|.++|..+.++|-|+.+.|....|.|.-|..+- - ++.+
T Consensus 114 IAVs~~~sg~i~VvD~~~d~~q~~~f--k------klH~sPV~~i~y~qa~Ds~vSiD~~gmVEyWs~e~~~qfPr~~l~ 185 (558)
T KOG0882|consen 114 IAVSLFKSGKIFVVDGFGDFCQDGYF--K------KLHFSPVKKIRYNQAGDSAVSIDISGMVEYWSAEGPFQFPRTNLN 185 (558)
T ss_pred EEeecccCCCcEEECCcCCcCcccee--c------ccccCceEEEEeeccccceeeccccceeEeecCCCcccCcccccc
Confidence 34444588999999965444433321 1 13779999999999999999999999999998762 0 0000
Q ss_pred --cc---cceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080 2308 --VR---PMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus 2308 --~k---~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
++ -+....---+...++.|+| +|..+++- +.|+.||+.++ -+++.++-++
T Consensus 186 ~~~K~eTdLy~f~K~Kt~pts~Efsp-~g~qistl---~~DrkVR~F~~--KtGklvqeiD 240 (558)
T KOG0882|consen 186 FELKHETDLYGFPKAKTEPTSFEFSP-DGAQISTL---NPDRKVRGFVF--KTGKLVQEID 240 (558)
T ss_pred ccccccchhhcccccccCccceEEcc-ccCccccc---CcccEEEEEEe--ccchhhhhhh
Confidence 00 0111111113455899999 99999985 59999999997 3555555443
No 379
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=52.72 E-value=92 Score=39.52 Aligned_cols=105 Identities=9% Similarity=-0.041 Sum_probs=62.1
Q ss_pred CCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCccc
Q 000080 2231 RPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRP 2310 (2389)
Q Consensus 2231 G~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~ 2310 (2389)
+..+..++.|+.+...|..+|+.+-+.. + + ....+ ..+|.++-.++.||.|...|.++|. .
T Consensus 256 ~~~vy~~~~~g~l~ald~~tG~~~W~~~-~--------~---~~~~~--~~~~~~vy~~~~~g~l~ald~~tG~-----~ 316 (394)
T PRK11138 256 GGVVYALAYNGNLVALDLRSGQIVWKRE-Y--------G---SVNDF--AVDGGRIYLVDQNDRVYALDTRGGV-----E 316 (394)
T ss_pred CCEEEEEEcCCeEEEEECCCCCEEEeec-C--------C---CccCc--EEECCEEEEEcCCCeEEEEECCCCc-----E
Confidence 4456667789999999999998765542 1 0 01111 2356677777888889888888763 1
Q ss_pred ceeee--ecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080 2311 MESCL--CFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus 2311 l~tl~--gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
+.... .+ ....+.+.. +|.+++. +.|+.|...|. .+|+.+....
T Consensus 317 ~W~~~~~~~-~~~~sp~v~--~g~l~v~----~~~G~l~~ld~--~tG~~~~~~~ 362 (394)
T PRK11138 317 LWSQSDLLH-RLLTAPVLY--NGYLVVG----DSEGYLHWINR--EDGRFVAQQK 362 (394)
T ss_pred EEcccccCC-CcccCCEEE--CCEEEEE----eCCCEEEEEEC--CCCCEEEEEE
Confidence 21111 11 111122222 4555543 47889998886 5677666554
No 380
>PF03178 CPSF_A: CPSF A subunit region; InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=52.50 E-value=98 Score=38.17 Aligned_cols=112 Identities=10% Similarity=0.095 Sum_probs=67.0
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc-eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK-ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk-~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
+|.+|+-- +|. |+.| .++.|++|++...+ .+..-. ... ...|.++ +..+++++.|+.-+.|.+..
T Consensus 90 ~V~ai~~~-~~~-lv~~-~g~~l~v~~l~~~~~l~~~~~-~~~--------~~~i~sl--~~~~~~I~vgD~~~sv~~~~ 155 (321)
T PF03178_consen 90 PVTAICSF-NGR-LVVA-VGNKLYVYDLDNSKTLLKKAF-YDS--------PFYITSL--SVFKNYILVGDAMKSVSLLR 155 (321)
T ss_dssp -EEEEEEE-TTE-EEEE-ETTEEEEEEEETTSSEEEEEE-E-B--------SSSEEEE--EEETTEEEEEESSSSEEEEE
T ss_pred cceEhhhh-CCE-EEEe-ecCEEEEEEccCcccchhhhe-ecc--------eEEEEEE--eccccEEEEEEcccCEEEEE
Confidence 35666655 444 4443 45899999998887 443321 111 1234444 44477999999999999886
Q ss_pred CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080 2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
.....+ ....+. -......+.++.|.+ |++.++.+ ..+++|.++...
T Consensus 156 ~~~~~~-~l~~va-~d~~~~~v~~~~~l~-d~~~~i~~---D~~gnl~~l~~~ 202 (321)
T PF03178_consen 156 YDEENN-KLILVA-RDYQPRWVTAAEFLV-DEDTIIVG---DKDGNLFVLRYN 202 (321)
T ss_dssp EETTTE--EEEEE-EESS-BEEEEEEEE--SSSEEEEE---ETTSEEEEEEE-
T ss_pred EEccCC-EEEEEE-ecCCCccEEEEEEec-CCcEEEEE---cCCCeEEEEEEC
Confidence 654221 111211 122356688999997 55566554 488999999973
No 381
>PF10313 DUF2415: Uncharacterised protein domain (DUF2415); InterPro: IPR019417 This entry represents a short (30 residues) domain of unknown function found in a family of fungal proteins. It contains a characteristic DLL sequence motif.
Probab=52.23 E-value=29 Score=32.19 Aligned_cols=30 Identities=20% Similarity=0.222 Sum_probs=26.3
Q ss_pred CEEEEEECCC-C--CEEEEEeCCCcEEEeeCCC
Q 000080 2273 SISALQFDHY-G--HRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus 2273 ~V~sVaFSPD-G--~~LASgS~DgTVkLWDl~t 2302 (2389)
.|++++|||+ | +.||-+-.-|.|.|+|+++
T Consensus 2 AvR~~kFsP~~~~~DLL~~~E~~g~vhi~D~R~ 34 (43)
T PF10313_consen 2 AVRCCKFSPEPGGNDLLAWAEHQGRVHIVDTRS 34 (43)
T ss_pred CeEEEEeCCCCCcccEEEEEccCCeEEEEEccc
Confidence 4899999985 4 5999999999999999985
No 382
>PF10168 Nup88: Nuclear pore component; InterPro: IPR019321 Nup88 can be divided into two structural domains; the N-terminal two-thirds of the protein have no obvious structural motifs. It is, however, where it binds to Nup98; one of the components of the nuclear pore. The C-terminal end is a predicted coiled-coil domain []. Nup88 is over expressed in tumour cells [].
Probab=51.80 E-value=92 Score=43.38 Aligned_cols=85 Identities=21% Similarity=0.253 Sum_probs=44.9
Q ss_pred EEEEeecCCCc-eEeeecc---cc-ccc-CCCC---CCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCC
Q 000080 191 LVSATWSIEGP-SATAASM---SQ-LDL-LGPK---EAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGD 261 (2389)
Q Consensus 191 ivsvaWSpdG~-fATag~d---ik-f~~-~~~~---~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~D 261 (2389)
|-.+.-||+|. +|-+|.. +. .+. |+.+ +.++....|..-.-. -.+....+.-.|..|+|||.+- .
T Consensus 87 v~~i~~n~~g~~lal~G~~~v~V~~LP~r~g~~~~~~~g~~~i~Crt~~v~-~~~~~~~~~~~i~qv~WhP~s~-----~ 160 (717)
T PF10168_consen 87 VHQISLNPTGSLLALVGPRGVVVLELPRRWGKNGEFEDGKKEINCRTVPVD-ERFFTSNSSLEIKQVRWHPWSE-----S 160 (717)
T ss_pred EEEEEECCCCCEEEEEcCCcEEEEEeccccCccccccCCCcceeEEEEEec-hhhccCCCCceEEEEEEcCCCC-----C
Confidence 33556699999 6666662 11 222 3321 122222233211000 0011245668999999999321 1
Q ss_pred CccccCceEEeeecCCeEEEEEeec
Q 000080 262 TKRSQRHVLLTCCLDGTVRLWCEMD 286 (2389)
Q Consensus 262 gk~~~~nILAScSdDgTVRLW~e~d 286 (2389)
..+ |+-=+.||++|+++..+
T Consensus 161 ----~~~-l~vLtsdn~lR~y~~~~ 180 (717)
T PF10168_consen 161 ----DSH-LVVLTSDNTLRLYDISD 180 (717)
T ss_pred ----CCe-EEEEecCCEEEEEecCC
Confidence 233 33444799999999764
No 383
>PF15390 DUF4613: Domain of unknown function (DUF4613)
Probab=51.57 E-value=2.4e+02 Score=38.62 Aligned_cols=130 Identities=16% Similarity=0.305 Sum_probs=78.1
Q ss_pred EecccceEEEEeecCCCC----eEEEEecc--eEEeec-----cCCcEEEEEEeeccccceEE--EEeecCCCc-eEeee
Q 000080 141 ILVQGTKVEAIEWTGSGD----GIVAGGME--TVLWKK-----KNTLWEIAWKFKENYPQNLV--SATWSIEGP-SATAA 206 (2389)
Q Consensus 141 tL~hssTV~sIAWSpdG~----rLaSggdD--V~IW~~-----~~s~Wecvwt~~~~~~~~iv--svaWSpdG~-fATag 206 (2389)
++.+--.|..++|.|-+. .|+++--. |.||+. ..+.|-+..++....+.++. ..-|.|... +|.-.
T Consensus 52 viGqFEhV~GlsW~P~~~~~~paLLAVQHkkhVtVWqL~~s~~e~~K~l~sQtcEi~e~~pvLpQGCVWHPk~~iL~VLT 131 (671)
T PF15390_consen 52 VIGQFEHVHGLSWAPPCTADTPALLAVQHKKHVTVWQLCPSTTERNKLLMSQTCEIREPFPVLPQGCVWHPKKAILTVLT 131 (671)
T ss_pred EeeccceeeeeeecCcccCCCCceEEEeccceEEEEEeccCccccccceeeeeeeccCCcccCCCcccccCCCceEEEEe
Confidence 344455789999999853 45555554 889994 45778888777666677777 456999877 55443
Q ss_pred c-ccc--cccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEE--E
Q 000080 207 S-MSQ--LDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVR--L 281 (2389)
Q Consensus 207 ~-dik--f~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVR--L 281 (2389)
+ |+. +.+. .| ..-.++..--.+-|.|-.|-+ ||.+ |+-+ ...++. |
T Consensus 132 ~~dvSV~~sV~-------------~d--~srVkaDi~~~G~IhCACWT~--------DG~R-----LVVA-vGSsLHSyi 182 (671)
T PF15390_consen 132 ARDVSVLPSVH-------------CD--SSRVKADIKTSGLIHCACWTK--------DGQR-----LVVA-VGSSLHSYI 182 (671)
T ss_pred cCceeEeeeee-------------eC--CceEEEeccCCceEEEEEecC--------cCCE-----EEEE-eCCeEEEEE
Confidence 3 443 1111 01 111223333446788999999 7766 5544 222444 5
Q ss_pred EEeecCCcccccccccCCCCccceeEEEEEE
Q 000080 282 WCEMDSGKTRKVAKDTNDHKTIRRSFCVGAI 312 (2389)
Q Consensus 282 W~e~d~Gk~kk~~~~~~d~~~~~~sF~vaA~ 312 (2389)
|| +..|. ..+|+||.+--
T Consensus 183 Wd--~~qKt-----------L~~CsfcPVFd 200 (671)
T PF15390_consen 183 WD--SAQKT-----------LHRCSFCPVFD 200 (671)
T ss_pred ec--Cchhh-----------hhhCCcceeec
Confidence 65 33333 23699997643
No 384
>PF00780 CNH: CNH domain; InterPro: IPR001180 Based on sequence similarities a domain of homology has been identified in the following proteins []: Citron and Citron kinase. These two proteins interact with the GTP-bound forms of the small GTPases Rho and Rac but not with Cdc42. Myotonic dystrophy kinase-related Cdc42-binding kinase (MRCKalpha). This serine/threonine kinase interacts with the GTP-bound form of the small GTPase Cdc42 and to a lesser extent with that of Rac. NCK Interacting Kinase (NIK), a serine/threonine protein kinase. ROM-1 and ROM-2, from yeast. These proteins are GDP/GTP exchange proteins (GEPs) for the small GTP binding protein Rho1. This domain, called the citron homology domain, is often found after cysteine rich and pleckstrin homology (PH) domains at the C-terminal end of the proteins []. It acts as a regulatory domain and could be involved in macromolecular interactions [, ].; GO: 0005083 small GTPase regulator activity
Probab=51.46 E-value=2.3e+02 Score=33.74 Aligned_cols=128 Identities=14% Similarity=0.132 Sum_probs=75.8
Q ss_pred CCCCeEEEEeCCCcEEEeecCCC-ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccC
Q 000080 2229 PLRPFFLVGSSNTHIYLWEFGKD-KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSN 2307 (2389)
Q Consensus 2229 PdG~~LASGS~DgTIRLWDl~tG-k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~ 2307 (2389)
..++.|+-|.+|| +.+++..++ +..+... ...|.++..-|+-+.|+.-++ +++.+.++..-....
T Consensus 5 ~~~~~L~vGt~~G-l~~~~~~~~~~~~~i~~------------~~~I~ql~vl~~~~~llvLsd-~~l~~~~L~~l~~~~ 70 (275)
T PF00780_consen 5 SWGDRLLVGTEDG-LYVYDLSDPSKPTRILK------------LSSITQLSVLPELNLLLVLSD-GQLYVYDLDSLEPVS 70 (275)
T ss_pred cCCCEEEEEECCC-EEEEEecCCccceeEee------------cceEEEEEEecccCEEEEEcC-CccEEEEchhhcccc
Confidence 4578899999999 999999333 3333332 244999999999888887765 999999997642100
Q ss_pred cc-cc--------eeeeecCCCeeEEE--EecCCCCEEEEeecCCCCCeEEEeeCCCCCC---CceEEEEeecCcEEEEe
Q 000080 2308 VR-PM--------ESCLCFSSHAMDVS--YITSSGSVIAAAGHSSNGINVVVWDTLAPPT---SSRASITCHEGLYDLFL 2373 (2389)
Q Consensus 2308 ~k-~l--------~tl~gHs~~V~sVA--FSP~DGslLASAG~sS~D~TVrLWD~l~~tg---~~v~sL~GH~~~V~svA 2373 (2389)
.. +. .......+.|..++ =.+..+..|+.+ ..++|.||....... +.++.+. -+..+.+++
T Consensus 71 ~~~~~~~~~~~~~~~~~~~~~~v~~f~~~~~~~~~~~L~va----~kk~i~i~~~~~~~~~f~~~~ke~~-lp~~~~~i~ 145 (275)
T PF00780_consen 71 TSAPLAFPKSRSLPTKLPETKGVSFFAVNGGHEGSRRLCVA----VKKKILIYEWNDPRNSFSKLLKEIS-LPDPPSSIA 145 (275)
T ss_pred ccccccccccccccccccccCCeeEEeeccccccceEEEEE----ECCEEEEEEEECCcccccceeEEEE-cCCCcEEEE
Confidence 00 00 00122334555555 112244566654 577999999843211 2334443 334455555
Q ss_pred ec
Q 000080 2374 PL 2375 (2389)
Q Consensus 2374 ~~ 2375 (2389)
+.
T Consensus 146 ~~ 147 (275)
T PF00780_consen 146 FL 147 (275)
T ss_pred Ee
Confidence 54
No 385
>PF07569 Hira: TUP1-like enhancer of split; InterPro: IPR011494 The Hira proteins are found in a range of eukaryotes and are implicated in the assembly of repressive chromatin. These proteins also contain IPR001680 from INTERPRO.; GO: 0006355 regulation of transcription, DNA-dependent, 0005634 nucleus
Probab=51.08 E-value=63 Score=38.60 Aligned_cols=73 Identities=15% Similarity=0.210 Sum_probs=54.0
Q ss_pred EEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCC--------CCCCCEEEEEECCCCCEEEEEeCCCcEE
Q 000080 2225 FSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPP--------YALASISALQFDHYGHRFASAALDGTVC 2296 (2389)
Q Consensus 2225 VAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~--------GH~~~V~sVaFSPDG~~LASgS~DgTVk 2296 (2389)
+.+..++.+|+.-..+|.+++||+.+++++..-.. - .|.. .....|.++.++.+|.-+++-+. |...
T Consensus 16 ~~l~~~~~~Ll~iT~~G~l~vWnl~~~k~~~~~~S--i--~pll~~~~~~~~~~~~~i~~~~lt~~G~PiV~lsn-g~~y 90 (219)
T PF07569_consen 16 SFLECNGSYLLAITSSGLLYVWNLKKGKAVLPPVS--I--APLLNSSPVSDKSSSPNITSCSLTSNGVPIVTLSN-GDSY 90 (219)
T ss_pred EEEEeCCCEEEEEeCCCeEEEEECCCCeeccCCcc--H--HHHhcccccccCCCCCcEEEEEEcCCCCEEEEEeC-CCEE
Confidence 45778899999999999999999999887533200 0 0101 24477999999999988887765 6788
Q ss_pred EeeCCC
Q 000080 2297 TWQLEV 2302 (2389)
Q Consensus 2297 LWDl~t 2302 (2389)
.||..-
T Consensus 91 ~y~~~L 96 (219)
T PF07569_consen 91 SYSPDL 96 (219)
T ss_pred Eecccc
Confidence 997764
No 386
>PRK13684 Ycf48-like protein; Provisional
Probab=49.55 E-value=1.9e+02 Score=36.45 Aligned_cols=110 Identities=17% Similarity=0.215 Sum_probs=60.2
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
.+.++.+.|++.+++.|....-.+.+|-+ |+.-.... . +-...++++++.|+|+.++.| ..|.+++=..
T Consensus 174 ~~~~i~~~~~g~~v~~g~~G~i~~s~~~g-g~tW~~~~---~------~~~~~l~~i~~~~~g~~~~vg-~~G~~~~~s~ 242 (334)
T PRK13684 174 VVRNLRRSPDGKYVAVSSRGNFYSTWEPG-QTAWTPHQ---R------NSSRRLQSMGFQPDGNLWMLA-RGGQIRFNDP 242 (334)
T ss_pred eEEEEEECCCCeEEEEeCCceEEEEcCCC-CCeEEEee---C------CCcccceeeeEcCCCCEEEEe-cCCEEEEccC
Confidence 45888999999888776544333444422 22111111 1 123679999999999877765 4577653212
Q ss_pred CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080 2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus 2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
..| .+=.........-+..+.+++|.| ++++++.+ .++.|.
T Consensus 243 d~G-~sW~~~~~~~~~~~~~l~~v~~~~-~~~~~~~G----~~G~v~ 283 (334)
T PRK13684 243 DDL-ESWSKPIIPEITNGYGYLDLAYRT-PGEIWAGG----GNGTLL 283 (334)
T ss_pred CCC-CccccccCCccccccceeeEEEcC-CCCEEEEc----CCCeEE
Confidence 222 110000000000123567899998 77888764 456544
No 387
>PF04841 Vps16_N: Vps16, N-terminal region; InterPro: IPR006926 This protein forms part of the Class C vacuolar protein sorting (Vps) complex. Vps16 is essential for vacuolar protein sorting, which is essential for viability in plants, but not yeast []. The Class C Vps complex is required for SNARE-mediated membrane fusion at the lysosome-like yeast vacuole. It is thought to play essential roles in membrane docking and fusion at the Golgi-to-endosome and endosome-to-vacuole stages of transport []. The role of VPS16 in this complex is not known.; GO: 0006886 intracellular protein transport, 0005737 cytoplasm
Probab=49.43 E-value=2.8e+02 Score=36.18 Aligned_cols=131 Identities=8% Similarity=-0.037 Sum_probs=71.6
Q ss_pred EEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCc
Q 000080 2226 SSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGR 2305 (2389)
Q Consensus 2226 AFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggr 2305 (2389)
.++.+....+....+++|.+=+-..-+. . +. .+.+..+++||+|+.+|--..+|++.+....-.
T Consensus 185 ~l~~~~~~~i~~~~g~~i~~i~~~~~~~---i---~~--------~~~i~~iavSpng~~iAl~t~~g~l~v~ssDf~-- 248 (410)
T PF04841_consen 185 LLSSDRVVEILLANGETIYIIDENSFKQ---I---DS--------DGPIIKIAVSPNGKFIALFTDSGNLWVVSSDFS-- 248 (410)
T ss_pred EeecCcceEEEEecCCEEEEEEcccccc---c---cC--------CCCeEEEEECCCCCEEEEEECCCCEEEEECccc--
Confidence 4666666666666666776333211111 1 11 246999999999999999999999888754322
Q ss_pred cCcccceeeeec-CCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080 2306 SNVRPMESCLCF-SSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus 2306 s~~k~l~tl~gH-s~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
+.+..+... ......++|-. +...+++ .+..|.|... .+..+.-....+ ..+.+-.||=++++.
T Consensus 249 ---~~~~e~~~~~~~~p~~~~WCG-~dav~l~-----~~~~l~lvg~---~~~~~~~~~~~~---~~l~~E~DG~riit~ 313 (410)
T PF04841_consen 249 ---EKLCEFDTDSKSPPKQMAWCG-NDAVVLS-----WEDELLLVGP---DGDSISFWYDGP---VILVSEIDGVRIITS 313 (410)
T ss_pred ---ceeEEeecCcCCCCcEEEEEC-CCcEEEE-----eCCEEEEECC---CCCceEEeccCc---eEEeccCCceEEEeC
Confidence 222222222 23344566665 3344443 2345666653 333332211111 336666677777765
Q ss_pred ccc
Q 000080 2385 CRC 2387 (2389)
Q Consensus 2385 ~~~ 2387 (2389)
=.|
T Consensus 314 ~~~ 316 (410)
T PF04841_consen 314 TSH 316 (410)
T ss_pred Cce
Confidence 544
No 388
>TIGR03606 non_repeat_PQQ dehydrogenase, PQQ-dependent, s-GDH family. PQQ, or pyrroloquinoline-quinone, serves as a cofactor for a number of sugar and alcohol dehydrogenases in a limited number of bacterial species. Most characterized PQQ-dependent enzymes have multiple repeats of a sequence region described by pfam01011 (PQQ enzyme repeat), but this protein family in unusual in lacking that repeat. Below the noise cutoff are related proteins mostly from species that lack PQQ biosynthesis.
Probab=47.66 E-value=2.2e+02 Score=37.86 Aligned_cols=110 Identities=9% Similarity=0.087 Sum_probs=61.5
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-------CEEEEEeC----
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-------HRFASAAL---- 2291 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-------~~LASgS~---- 2291 (2389)
|+|+|-|||++|++--..|.|++++-.++...... .++.- ....+ ......|+|+||= ...++-+.
T Consensus 33 w~maflPDG~llVtER~~G~I~~v~~~~~~~~~~~-~l~~v-~~~~g-e~GLlglal~PdF~~~~~n~~lYvsyt~~~~~ 109 (454)
T TIGR03606 33 WALLWGPDNQLWVTERATGKILRVNPETGEVKVVF-TLPEI-VNDAQ-HNGLLGLALHPDFMQEKGNPYVYISYTYKNGD 109 (454)
T ss_pred eEEEEcCCCeEEEEEecCCEEEEEeCCCCceeeee-cCCce-eccCC-CCceeeEEECCCccccCCCcEEEEEEeccCCC
Confidence 88999999999998665799999986555422111 11110 00012 3668999999984 23444211
Q ss_pred -----CCcEEEeeCCCCCc--cCcccce-ee---eecCCCeeEEEEecCCCCEEEEee
Q 000080 2292 -----DGTVCTWQLEVGGR--SNVRPME-SC---LCFSSHAMDVSYITSSGSVIAAAG 2338 (2389)
Q Consensus 2292 -----DgTVkLWDl~tggr--s~~k~l~-tl---~gHs~~V~sVAFSP~DGslLASAG 2338 (2389)
...|.-|.+..... ...+.+. .+ .+|.+ ..++|.| ||.+.++.|
T Consensus 110 ~~~~~~~~I~R~~l~~~~~~l~~~~~Il~~lP~~~~H~G--grI~FgP-DG~LYVs~G 164 (454)
T TIGR03606 110 KELPNHTKIVRYTYDKSTQTLEKPVDLLAGLPAGNDHNG--GRLVFGP-DGKIYYTIG 164 (454)
T ss_pred CCccCCcEEEEEEecCCCCccccceEEEecCCCCCCcCC--ceEEECC-CCcEEEEEC
Confidence 22343344432100 0111121 11 13443 4689999 999999877
No 389
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=47.26 E-value=1.2e+02 Score=38.56 Aligned_cols=99 Identities=11% Similarity=0.008 Sum_probs=58.3
Q ss_pred CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcc
Q 000080 2230 LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVR 2309 (2389)
Q Consensus 2230 dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k 2309 (2389)
++..|..++.|+.+...|..+|+.+-....+ .+ ....+.+. .+.++..++.||.|...|..+|.
T Consensus 293 ~~~~vy~~~~~g~l~ald~~tG~~~W~~~~~-~~--------~~~~sp~v--~~g~l~v~~~~G~l~~ld~~tG~----- 356 (394)
T PRK11138 293 DGGRIYLVDQNDRVYALDTRGGVELWSQSDL-LH--------RLLTAPVL--YNGYLVVGDSEGYLHWINREDGR----- 356 (394)
T ss_pred ECCEEEEEcCCCeEEEEECCCCcEEEccccc-CC--------CcccCCEE--ECCEEEEEeCCCEEEEEECCCCC-----
Confidence 4556666789999999999999876443211 11 11111112 25677888999999999999873
Q ss_pred cceeeeecCCCee-EEEEecCCCCEEEEeecCCCCCeEEEee
Q 000080 2310 PMESCLCFSSHAM-DVSYITSSGSVIAAAGHSSNGINVVVWD 2350 (2389)
Q Consensus 2310 ~l~tl~gHs~~V~-sVAFSP~DGslLASAG~sS~D~TVrLWD 2350 (2389)
.+....-....+. +-++. +|++++. +.|++|...+
T Consensus 357 ~~~~~~~~~~~~~s~P~~~--~~~l~v~----t~~G~l~~~~ 392 (394)
T PRK11138 357 FVAQQKVDSSGFLSEPVVA--DDKLLIQ----ARDGTVYAIT 392 (394)
T ss_pred EEEEEEcCCCcceeCCEEE--CCEEEEE----eCCceEEEEe
Confidence 3333221222222 22222 5565554 4788877665
No 390
>PF06977 SdiA-regulated: SdiA-regulated; InterPro: IPR009722 This entry represents a conserved region approximately 100 residues long within a number of hypothetical bacterial proteins that may be regulated by SdiA, a member of the LuxR family of transcriptional regulators []. Some proteins contain the IPR001258 from INTERPRO repeat.; PDB: 3QQZ_A.
Probab=47.15 E-value=2.8e+02 Score=34.19 Aligned_cols=116 Identities=11% Similarity=0.112 Sum_probs=69.2
Q ss_pred EEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080 2222 TRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus 2222 VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
+..|+|+|+.. +++....++.|.-.+. +|+.++++. +. | .+..-.|++--+|.++++--.++++.+-++
T Consensus 24 ~SGLTy~pd~~tLfaV~d~~~~i~els~-~G~vlr~i~-l~-------g-~~D~EgI~y~g~~~~vl~~Er~~~L~~~~~ 93 (248)
T PF06977_consen 24 LSGLTYNPDTGTLFAVQDEPGEIYELSL-DGKVLRRIP-LD-------G-FGDYEGITYLGNGRYVLSEERDQRLYIFTI 93 (248)
T ss_dssp EEEEEEETTTTEEEEEETTTTEEEEEET-T--EEEEEE--S-------S--SSEEEEEE-STTEEEEEETTTTEEEEEEE
T ss_pred ccccEEcCCCCeEEEEECCCCEEEEEcC-CCCEEEEEe-CC-------C-CCCceeEEEECCCEEEEEEcCCCcEEEEEE
Confidence 59999999855 6666778888887886 688887764 22 2 256899999877765555546999999998
Q ss_pred CCCCccC-cccceee-----eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2301 EVGGRSN-VRPMESC-----LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2301 ~tggrs~-~k~l~tl-----~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
...++.. ...+..+ ..++.....+||.|..+++++ + -+..-.+|+.+
T Consensus 94 ~~~~~~~~~~~~~~~~l~~~~~~N~G~EGla~D~~~~~L~v-~---kE~~P~~l~~~ 146 (248)
T PF06977_consen 94 DDDTTSLDRADVQKISLGFPNKGNKGFEGLAYDPKTNRLFV-A---KERKPKRLYEV 146 (248)
T ss_dssp ----TT--EEEEEEEE---S---SS--EEEEEETTTTEEEE-E---EESSSEEEEEE
T ss_pred eccccccchhhceEEecccccCCCcceEEEEEcCCCCEEEE-E---eCCCChhhEEE
Confidence 4432110 0111111 124566889999995555554 3 36666777776
No 391
>PF15390 DUF4613: Domain of unknown function (DUF4613)
Probab=46.96 E-value=61 Score=43.69 Aligned_cols=98 Identities=15% Similarity=0.272 Sum_probs=69.7
Q ss_pred CccEEEEEeeccccCcce--eEeeceeccCCce----EEEEeEEccCCcEEEEEeecceEEEEEeccCCccccccccccc
Q 000080 802 AVSNVRIWESVCVTELGS--FVLEDTLSFDTNI----VAVNWLTLENGQSLLGVCLQNELKVYAQRHYGGQILLDTKNSL 875 (2389)
Q Consensus 802 ~~s~vsIWD~~~~sgGGs--wvLE~ti~ld~~I----VdLDWtStEDGqhILTVGfg~kVlLYtQlRydytn~~~~~~ll 875 (2389)
..++|++|.. |.++..+ |+.-||-++.+.+ +..=|=-+ .-||||=-...+=++--.|.|...
T Consensus 80 HkkhVtVWqL-~~s~~e~~K~l~sQtcEi~e~~pvLpQGCVWHPk---~~iL~VLT~~dvSV~~sV~~d~sr-------- 147 (671)
T PF15390_consen 80 HKKHVTVWQL-CPSTTERNKLLMSQTCEIREPFPVLPQGCVWHPK---KAILTVLTARDVSVLPSVHCDSSR-------- 147 (671)
T ss_pred ccceEEEEEe-ccCccccccceeeeeeeccCCcccCCCcccccCC---CceEEEEecCceeEeeeeeeCCce--------
Confidence 4678999998 8665555 9999998885422 34445443 569999999999666666777221
Q ss_pred ccccceeeccCCCCCccccccccCce-EEEEecCeeEEeeccc
Q 000080 876 KMQNWFCLAFSPTFAAHDFTWGRRAI-AIVVHQSYLSIYSQFL 917 (2389)
Q Consensus 876 ~~~~w~~Id~~~T~hIgDssWVRDGI-LVVGmgnEMhVYSQWl 917 (2389)
+-+|....-+|..=+|.+||- |||+-|+-+|-|- |.
T Consensus 148 -----VkaDi~~~G~IhCACWT~DG~RLVVAvGSsLHSyi-Wd 184 (671)
T PF15390_consen 148 -----VKADIKTSGLIHCACWTKDGQRLVVAVGSSLHSYI-WD 184 (671)
T ss_pred -----EEEeccCCceEEEEEecCcCCEEEEEeCCeEEEEE-ec
Confidence 113333333488889999995 9999999999885 54
No 392
>KOG4460 consensus Nuclear pore complex, Nup88/rNup84 component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=46.50 E-value=1.4e+02 Score=39.95 Aligned_cols=85 Identities=20% Similarity=0.270 Sum_probs=52.9
Q ss_pred eEEEEeecCCCc-eEeeeccc---c-c-ccCC---CCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCC
Q 000080 190 NLVSATWSIEGP-SATAASMS---Q-L-DLLG---PKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPG 260 (2389)
Q Consensus 190 ~ivsvaWSpdG~-fATag~di---k-f-~~~~---~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~ 260 (2389)
.++.|.=|++|. .|-+|-+. . . ++|| .-.++||+.+|..-+-..-.++.. -.-.+.-++|||.+.
T Consensus 105 eV~~vl~s~~GS~VaL~G~~Gi~vMeLp~rwG~~s~~eDgk~~v~CRt~~i~~~~ftss-~~ltl~Qa~WHP~S~----- 178 (741)
T KOG4460|consen 105 EVYQVLLSPTGSHVALIGIKGLMVMELPKRWGKNSEFEDGKSTVNCRTTPVAERFFTSS-TSLTLKQAAWHPSSI----- 178 (741)
T ss_pred EEEEEEecCCCceEEEecCCeeEEEEchhhcCccceecCCCceEEEEeecccceeeccC-CceeeeeccccCCcc-----
Confidence 556677789999 55555422 2 2 2354 346789999997644433334444 335788999999421
Q ss_pred CCccccCceEEeeecCCeEEEEEee
Q 000080 261 DTKRSQRHVLLTCCLDGTVRLWCEM 285 (2389)
Q Consensus 261 Dgk~~~~nILAScSdDgTVRLW~e~ 285 (2389)
...++++ =+-|++|||++..
T Consensus 179 ----~D~hL~i-L~sdnviRiy~lS 198 (741)
T KOG4460|consen 179 ----LDPHLVL-LTSDNVIRIYSLS 198 (741)
T ss_pred ----CCceEEE-EecCcEEEEEecC
Confidence 1233333 3579999999976
No 393
>PF13449 Phytase-like: Esterase-like activity of phytase
Probab=46.25 E-value=1.8e+02 Score=36.47 Aligned_cols=125 Identities=14% Similarity=0.207 Sum_probs=73.9
Q ss_pred EEEEcCCCCeEEEEeCC------CcEEEeecCCCceeeEecccCCCCCC------CCCCCCCEEEEEECCCCCEEEEEeC
Q 000080 2224 AFSSHPLRPFFLVGSSN------THIYLWEFGKDKATATYGVLPAANVP------PPYALASISALQFDHYGHRFASAAL 2291 (2389)
Q Consensus 2224 sVAFsPdG~~LASGS~D------gTIRLWDl~tGk~l~Tl~vl~gh~~p------~~GH~~~V~sVaFSPDG~~LASgS~ 2291 (2389)
+|++.++|.+++|.=.+ ..|+-++.. |+.+..+. +|...-+ ........-+++++|||++|.++-+
T Consensus 89 gi~~~~~g~~~is~E~~~~~~~~p~I~~~~~~-G~~~~~~~-vP~~~~~~~~~~~~~~~N~G~E~la~~~dG~~l~~~~E 166 (326)
T PF13449_consen 89 GIAVPPDGSFWISSEGGRTGGIPPRIRRFDLD-GRVIRRFP-VPAAFLPDANGTSGRRNNRGFEGLAVSPDGRTLFAAME 166 (326)
T ss_pred HeEEecCCCEEEEeCCccCCCCCCEEEEECCC-CcccceEc-cccccccccCccccccCCCCeEEEEECCCCCEEEEEEC
Confidence 44778999999986666 778888865 88766663 2332100 0113457899999999996666543
Q ss_pred -----CC--c-------EEEeeCC--CCCccCcccceeeee-----cCCCeeEEEEecCCCCEEEEee-cC-CCCCeEEE
Q 000080 2292 -----DG--T-------VCTWQLE--VGGRSNVRPMESCLC-----FSSHAMDVSYITSSGSVIAAAG-HS-SNGINVVV 2348 (2389)
Q Consensus 2292 -----Dg--T-------VkLWDl~--tggrs~~k~l~tl~g-----Hs~~V~sVAFSP~DGslLASAG-~s-S~D~TVrL 2348 (2389)
|+ . +||+... +.+...-+-.+.+.. ....+.++++.+ +|++|+-== +. .....+||
T Consensus 167 ~~l~~d~~~~~~~~~~~~ri~~~d~~~~~~~~~~~~y~ld~~~~~~~~~~isd~~al~-d~~lLvLER~~~~~~~~~~ri 245 (326)
T PF13449_consen 167 SPLKQDGPRANPDNGSPLRILRYDPKTPGEPVAEYAYPLDPPPTAPGDNGISDIAALP-DGRLLVLERDFSPGTGNYKRI 245 (326)
T ss_pred ccccCCCcccccccCceEEEEEecCCCCCccceEEEEeCCccccccCCCCceeEEEEC-CCcEEEEEccCCCCccceEEE
Confidence 22 2 6666444 311000011223322 456788999999 888877310 00 13456777
Q ss_pred eeC
Q 000080 2349 WDT 2351 (2389)
Q Consensus 2349 WD~ 2351 (2389)
..+
T Consensus 246 ~~v 248 (326)
T PF13449_consen 246 YRV 248 (326)
T ss_pred EEE
Confidence 765
No 394
>PRK11447 cellulose synthase subunit BcsC; Provisional
Probab=45.23 E-value=7.2e+02 Score=36.68 Aligned_cols=63 Identities=17% Similarity=0.185 Sum_probs=44.4
Q ss_pred HHHHHHHHHHhcCCChhhhhcccCCCCCCCCCCccccccCCCcccccccccCCCCCCCccccccccccccccccccccHH
Q 000080 1463 AALMRATALNRCGLPLEALDCLSSSPSTIGGTDQESVLNIGHSHILPEILKPSAATGSSNWLLRDVALHLESCAKLDLSL 1542 (2389)
Q Consensus 1463 ~~l~~a~~l~RmGC~lLALdll~~s~~~~~~~~~~s~~~~~~~~~~~~~~~~~~~~~~~nw~~~~~~~~~~~~~~~~~~~ 1542 (2389)
.++..|..+.++|-.-.|+++++. .|. +.++--..+..++...+.+.|+
T Consensus 575 ~~l~~a~~l~~~G~~~eA~~~l~~--------------------------~p~-----~~~~~~~La~~~~~~g~~~~A~ 623 (1157)
T PRK11447 575 QVLETANRLRDSGKEAEAEALLRQ--------------------------QPP-----STRIDLTLADWAQQRGDYAAAR 623 (1157)
T ss_pred HHHHHHHHHHHCCCHHHHHHHHHh--------------------------CCC-----CchHHHHHHHHHHHcCCHHHHH
Confidence 345667778999999999988872 011 0112233455677888999999
Q ss_pred HHHHHHhhcCCCCC
Q 000080 1543 QYFSKLIRDHPSWP 1556 (2389)
Q Consensus 1543 ~~~s~~~~~~~~~~ 1556 (2389)
.+|.++++..|.-+
T Consensus 624 ~~y~~al~~~P~~~ 637 (1157)
T PRK11447 624 AAYQRVLTREPGNA 637 (1157)
T ss_pred HHHHHHHHhCCCCH
Confidence 99999999987543
No 395
>PF14655 RAB3GAP2_N: Rab3 GTPase-activating protein regulatory subunit N-terminus
Probab=43.45 E-value=83 Score=41.20 Aligned_cols=77 Identities=13% Similarity=0.130 Sum_probs=50.3
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC--------------CCEE
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY--------------GHRF 2286 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD--------------G~~L 2286 (2389)
.+.+|+.+|++++.|..-.=|.|.|+|+.++..++.+++..+. +.++|....-... ..+|
T Consensus 309 ~~~~i~~sP~~~laA~tDslGRV~LiD~~~~~vvrmWKGYRdA------qc~wi~~~~~~~~~~~~~~~~~~~~~~~l~L 382 (415)
T PF14655_consen 309 EGESICLSPSGRLAAVTDSLGRVLLIDVARGIVVRMWKGYRDA------QCGWIEVPEEGDRDRSNSNSPKSSSRFALFL 382 (415)
T ss_pred eEEEEEECCCCCEEEEEcCCCcEEEEECCCChhhhhhccCccc------eEEEEEeecccccccccccccCCCCcceEEE
Confidence 3578899999999888777799999999999988777643332 1223322222111 1122
Q ss_pred EE-EeCCCcEEEeeCCCC
Q 000080 2287 AS-AALDGTVCTWQLEVG 2303 (2389)
Q Consensus 2287 AS-gS~DgTVkLWDl~tg 2303 (2389)
+- +-.=|.|-+|++++|
T Consensus 383 vIyaprRg~lEvW~~~~g 400 (415)
T PF14655_consen 383 VIYAPRRGILEVWSMRQG 400 (415)
T ss_pred EEEeccCCeEEEEecCCC
Confidence 22 445688889988876
No 396
>PLN00033 photosystem II stability/assembly factor; Provisional
Probab=43.39 E-value=4.5e+02 Score=34.51 Aligned_cols=133 Identities=13% Similarity=0.039 Sum_probs=74.4
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCC-ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCC
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKD-KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tG-k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~ 2301 (2389)
..+...+||.+++.|....-.+-||-+.. ...... + ....++++.|.+||..++.+ .+|.+ +|...
T Consensus 242 ~~v~~~~dG~~~~vg~~G~~~~s~d~G~~~W~~~~~---~--------~~~~l~~v~~~~dg~l~l~g-~~G~l-~~S~d 308 (398)
T PLN00033 242 STVNRSPDGDYVAVSSRGNFYLTWEPGQPYWQPHNR---A--------SARRIQNMGWRADGGLWLLT-RGGGL-YVSKG 308 (398)
T ss_pred eeEEEcCCCCEEEEECCccEEEecCCCCcceEEecC---C--------CccceeeeeEcCCCCEEEEe-CCceE-EEecC
Confidence 55678899999888766665667875422 122221 1 12568999999999888766 44553 33333
Q ss_pred CCCccC-cccceeeee--cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEE---EeecCcEEEEeec
Q 000080 2302 VGGRSN-VRPMESCLC--FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASI---TCHEGLYDLFLPL 2375 (2389)
Q Consensus 2302 tggrs~-~k~l~tl~g--Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL---~GH~~~V~svA~~ 2375 (2389)
.+ +.- ...+....- -...+.++.|.+ +++.+|++ .++.|....- .++.=+.. ..=....+.+.+.
T Consensus 309 ~G-~~~~~~~f~~~~~~~~~~~l~~v~~~~-d~~~~a~G----~~G~v~~s~D---~G~tW~~~~~~~~~~~~ly~v~f~ 379 (398)
T PLN00033 309 TG-LTEEDFDFEEADIKSRGFGILDVGYRS-KKEAWAAG----GSGILLRSTD---GGKSWKRDKGADNIAANLYSVKFF 379 (398)
T ss_pred CC-CcccccceeecccCCCCcceEEEEEcC-CCcEEEEE----CCCcEEEeCC---CCcceeEccccCCCCcceeEEEEc
Confidence 22 100 001121111 113478899998 88988874 6677766652 23332222 2223445667655
Q ss_pred cc
Q 000080 2376 KL 2377 (2389)
Q Consensus 2376 ~~ 2377 (2389)
..
T Consensus 380 ~~ 381 (398)
T PLN00033 380 DD 381 (398)
T ss_pred CC
Confidence 43
No 397
>PF12110 Nup96: Nuclear protein 96; InterPro: IPR021967 Nup96 (often known by the name of its yeast homologue Nup145C) is part of the Nup84 heptameric complex in the nuclear pore complex. Nup96 complexes with Sec13 in the middle of the heptamer. The function of the heptamer is to coat the curvature of the nuclear pore complex between the inner and outer nuclear membranes. Nup96 is predicted to be an alpha helical solenoid. The interaction between Nup96 and Sec13 is the point of curvature in the heptameric complex [], [].; PDB: 3BG1_C 3BG0_F 3IKO_B.
Probab=43.35 E-value=32 Score=42.48 Aligned_cols=48 Identities=25% Similarity=0.397 Sum_probs=32.6
Q ss_pred hHHHHHHHHhcCChhHHHHHHHHhcCChhhhhhhhhhhccCCChhhHhhHhh
Q 000080 1325 LELAIAFFLLGGDAASAVTVCARNLGDVQLALVICRLVEKHGGPLERNLVTK 1376 (2389)
Q Consensus 1325 y~~AAAFFLLAg~lkDAV~Vc~~~L~D~qLAi~IaRLyEgd~gp~l~~lL~~ 1376 (2389)
|+..+--.|.++++.+|++++++. +|+.||.+|+-+ . ++|..|.++++
T Consensus 2 ~le~if~~L~~~~i~~A~~~A~~~-~n~~LA~Llsq~-~--~~~~~r~~~~~ 49 (290)
T PF12110_consen 2 PLEKIFLLLSGHDIEEACELAIDS-GNPHLATLLSQI-G--GDPAVRSLAKQ 49 (290)
T ss_dssp HHHHHHHHHHTT-HHHHHHHHHHT-T-HHHHHHHHHT-S----HHHHHHHHH
T ss_pred HHHHHHHHHHCCCHHHHHHHHHHC-CCchHHHHHHHh-c--CCHHHHHHHHH
Confidence 344555567788999999999987 999999999999 2 23445444443
No 398
>PF14761 HPS3_N: Hermansky-Pudlak syndrome 3
Probab=43.16 E-value=5.1e+02 Score=31.67 Aligned_cols=126 Identities=15% Similarity=0.166 Sum_probs=74.5
Q ss_pred CcE-EEecCCeEEEEeeCCCCCCCCccceeeEEecccceEEEEeecCCCCeEEEEecc--------eEEeeccCCcEEEE
Q 000080 110 GQL-AAASENCIFVFAHDSASSKGSFCWSQNAILVQGTKVEAIEWTGSGDGIVAGGME--------TVLWKKKNTLWEIA 180 (2389)
Q Consensus 110 GeI-aASyDntIRVw~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSpdG~rLaSggdD--------V~IW~~~~s~Wecv 180 (2389)
+.| +|..+++|.+|.-.. .. =....++.--++|+.++.+..|++|+|--.+ ++++-. |++.
T Consensus 29 d~Lfva~~g~~Vev~~l~~----~~--~~~~~~F~Tv~~V~~l~y~~~GDYlvTlE~k~~~~~~~fvR~Y~N----Wr~~ 98 (215)
T PF14761_consen 29 DALFVAASGCKVEVYDLEQ----EE--CPLLCTFSTVGRVLQLVYSEAGDYLVTLEEKNKRSPVDFVRAYFN----WRSQ 98 (215)
T ss_pred ceEEEEcCCCEEEEEEccc----CC--CceeEEEcchhheeEEEeccccceEEEEEeecCCccceEEEEEEE----hhhh
Confidence 455 357789999998541 01 1223445445899999999999999986553 333331 4332
Q ss_pred EEeeccccceEEEEeecCCCceEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCC
Q 000080 181 WKFKENYPQNLVSATWSIEGPSATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPG 260 (2389)
Q Consensus 181 wt~~~~~~~~ivsvaWSpdG~fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~ 260 (2389)
. ....++ ++ .+| |...+ +.. . ...+.+.+.+|..=+.++.+|+=.|
T Consensus 99 ~----~~~~~v-~v------Ria--G~~v~----~~~---~------~~~~~qleiiElPl~~~p~ciaCC~-------- 144 (215)
T PF14761_consen 99 K----EENSPV-RV------RIA--GHRVT----PSF---N------ESSKDQLEIIELPLSEPPLCIACCP-------- 144 (215)
T ss_pred c----ccCCcE-EE------EEc--ccccc----cCC---C------CccccceEEEEecCCCCCCEEEecC--------
Confidence 1 011111 11 011 11111 000 0 0113346677888888999999999
Q ss_pred CCccccCceEEeeecCCeEEEEEee
Q 000080 261 DTKRSQRHVLLTCCLDGTVRLWCEM 285 (2389)
Q Consensus 261 Dgk~~~~nILAScSdDgTVRLW~e~ 285 (2389)
...|+|+.| ++++-||...
T Consensus 145 ----~tG~LlVg~--~~~l~lf~l~ 163 (215)
T PF14761_consen 145 ----VTGNLLVGC--GNKLVLFTLK 163 (215)
T ss_pred ----CCCCEEEEc--CCEEEEEEEE
Confidence 467888877 7899999976
No 399
>KOG4460 consensus Nuclear pore complex, Nup88/rNup84 component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=42.40 E-value=61 Score=43.02 Aligned_cols=82 Identities=23% Similarity=0.329 Sum_probs=51.8
Q ss_pred CcceeecCCCCCCeEEEEecCCcEEEEeCCC---Cccccc-------ccccccceeeeeccCCCCCeeEEEEcCCCCCCC
Q 000080 41 TSTIDWLPDFAGYSWVAYGASSLLVISHFPS---PLSQEE-------ALIGPIFRQVFALSDNSLPVTSISWSPETPSIG 110 (2389)
Q Consensus 41 ~~ai~wlpD~~G~~~vAYasg~~vVI~~l~S---P~~~~e-------~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~G 110 (2389)
+.++.-+|. | +-||-+..++++|--||- |.+.++ |..=|+=-|++.-+.+ ..++-++|||++-+-.
T Consensus 106 V~~vl~s~~--G-S~VaL~G~~Gi~vMeLp~rwG~~s~~eDgk~~v~CRt~~i~~~~ftss~~-ltl~Qa~WHP~S~~D~ 181 (741)
T KOG4460|consen 106 VYQVLLSPT--G-SHVALIGIKGLMVMELPKRWGKNSEFEDGKSTVNCRTTPVAERFFTSSTS-LTLKQAAWHPSSILDP 181 (741)
T ss_pred EEEEEecCC--C-ceEEEecCCeeEEEEchhhcCccceecCCCceEEEEeecccceeeccCCc-eeeeeccccCCccCCc
Confidence 344444454 6 689999999999988763 443333 1112444455555433 5799999999721112
Q ss_pred cEE-EecCCeEEEEeeC
Q 000080 111 QLA-AASENCIFVFAHD 126 (2389)
Q Consensus 111 eIa-ASyDntIRVw~~d 126 (2389)
-++ -++||+||||...
T Consensus 182 hL~iL~sdnviRiy~lS 198 (741)
T KOG4460|consen 182 HLVLLTSDNVIRIYSLS 198 (741)
T ss_pred eEEEEecCcEEEEEecC
Confidence 233 5889999999875
No 400
>PF12931 Sec16_C: Sec23-binding domain of Sec16; PDB: 3MZK_C.
Probab=42.24 E-value=43 Score=41.30 Aligned_cols=75 Identities=21% Similarity=0.252 Sum_probs=44.0
Q ss_pred HHhcCChhHHHHHHHHhcCChhhhhhhhhhhccCCChhhHhhHhhhccccccccCC------hhHHHHHHHHhCChhHHH
Q 000080 1332 FLLGGDAASAVTVCARNLGDVQLALVICRLVEKHGGPLERNLVTKFILPSSIERGD------YWLTSLLEWELGNYSQSF 1405 (2389)
Q Consensus 1332 FLLAg~lkDAV~Vc~~~L~D~qLAi~IaRLyEgd~gp~l~~lL~~~vLp~a~~~gD------rwL~S~a~W~L~~~~~Av 1405 (2389)
+||.|+.++||+.|+++ ++...|++||+.... ...+++.++++--.- ..++ ..|+-+.-=.-|+-..+|
T Consensus 5 ~Ll~G~~~~Av~~al~~-~~wa~ALlLAs~~g~---e~~~~v~~~y~~~~~-~~~~~~~~~~~~L~~l~~v~~g~~~~~v 79 (284)
T PF12931_consen 5 LLLVGNREEAVELALDN-GLWAHALLLASSLGP---ELWKKVVQEYFRREF-SAGSPSSKITHLLRTLYQVFSGNSPEAV 79 (284)
T ss_dssp HHHTT-HHHHHHHHHHT-T-HHHHHHHHHTS-H---HHHHHHHHHHHH---------THHHHHHHHHHHHHTTT-HHHHH
T ss_pred HHhCCCHHHHHHHHHHC-CChHHHHHHHHhcCH---HHHHHHHHHHHHHhc-cCCCCcchhhHHHHHHHHHHcCCcHHHH
Confidence 68999999999999998 999999999998833 345555555443221 1122 233333333346666677
Q ss_pred HHHhcC
Q 000080 1406 LTMLGF 1411 (2389)
Q Consensus 1406 ~~Ll~~ 1411 (2389)
+.|...
T Consensus 80 ~~l~~~ 85 (284)
T PF12931_consen 80 DELVPN 85 (284)
T ss_dssp HHHHH-
T ss_pred HHhccc
Confidence 766654
No 401
>PF05935 Arylsulfotrans: Arylsulfotransferase (ASST); InterPro: IPR010262 This family consists of several bacterial arylsulphotransferase proteins. Arylsulphotransferase (ASST) transfers a sulphate group from phenolic sulphate esters to a phenolic acceptor substrate [].; PDB: 3ETT_B 3ELQ_A 3ETS_A.
Probab=41.40 E-value=2.6e+02 Score=37.22 Aligned_cols=124 Identities=17% Similarity=0.231 Sum_probs=63.2
Q ss_pred EEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe--------------
Q 000080 2225 FSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA-------------- 2290 (2389)
Q Consensus 2225 VAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-------------- 2290 (2389)
+-+-++|.+++..+ ..++..|+ -|+.+..+. +++... .-| +.+.+-|+|+.|+.+.
T Consensus 153 ~~~l~nG~ll~~~~--~~~~e~D~-~G~v~~~~~-l~~~~~--~~H----HD~~~l~nGn~L~l~~~~~~~~~~~~~~~~ 222 (477)
T PF05935_consen 153 FKQLPNGNLLIGSG--NRLYEIDL-LGKVIWEYD-LPGGYY--DFH----HDIDELPNGNLLILASETKYVDEDKDVDTV 222 (477)
T ss_dssp EEE-TTS-EEEEEB--TEEEEE-T-T--EEEEEE---TTEE---B-----S-EEE-TTS-EEEEEEETTEE-TS-EE---
T ss_pred eeEcCCCCEEEecC--CceEEEcC-CCCEEEeee-cCCccc--ccc----cccEECCCCCEEEEEeecccccCCCCccEe
Confidence 56789999887655 88999998 688777765 333100 003 4566889999999888
Q ss_pred CC---------CcEEEeeCCCCCccCccccee----------eeecC-----CCeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080 2291 LD---------GTVCTWQLEVGGRSNVRPMES----------CLCFS-----SHAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus 2291 ~D---------gTVkLWDl~tggrs~~k~l~t----------l~gHs-----~~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
.| ..|..||+.. .+.+.+. ..+-. -+++++.|.+.++.+|+|+ =.-.+|
T Consensus 223 ~D~Ivevd~tG~vv~~wd~~d----~ld~~~~~~~~~~~~~~~~~~~~~~DW~H~Nsi~yd~~dd~iivSs---R~~s~V 295 (477)
T PF05935_consen 223 EDVIVEVDPTGEVVWEWDFFD----HLDPYRDTVLKPYPYGDISGSGGGRDWLHINSIDYDPSDDSIIVSS---RHQSAV 295 (477)
T ss_dssp S-EEEEE-TTS-EEEEEEGGG----TS-TT--TTGGT--SSSSS-SSTTSBS--EEEEEEETTTTEEEEEE---TTT-EE
T ss_pred cCEEEEECCCCCEEEEEehHH----hCCcccccccccccccccccCCCCCCccccCccEEeCCCCeEEEEc---CcceEE
Confidence 23 3344565543 1111111 00000 4789999999788899884 123366
Q ss_pred EEeeCCCCCCCceEEEEeecC
Q 000080 2347 VVWDTLAPPTSSRASITCHEG 2367 (2389)
Q Consensus 2347 rLWD~l~~tg~~v~sL~GH~~ 2367 (2389)
-..|. .+++.+..|-.|.+
T Consensus 296 ~~Id~--~t~~i~Wilg~~~~ 314 (477)
T PF05935_consen 296 IKIDY--RTGKIKWILGPPGG 314 (477)
T ss_dssp EEEE---TTS-EEEEES-STT
T ss_pred EEEEC--CCCcEEEEeCCCCC
Confidence 66663 45555555555543
No 402
>PF07569 Hira: TUP1-like enhancer of split; InterPro: IPR011494 The Hira proteins are found in a range of eukaryotes and are implicated in the assembly of repressive chromatin. These proteins also contain IPR001680 from INTERPRO.; GO: 0006355 regulation of transcription, DNA-dependent, 0005634 nucleus
Probab=41.27 E-value=89 Score=37.36 Aligned_cols=69 Identities=16% Similarity=0.279 Sum_probs=49.8
Q ss_pred EEECCCCCEEEEEeCCCcEEEeeCCCCCccCccc--ceeee--------ecCCCeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080 2277 LQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRP--MESCL--------CFSSHAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus 2277 VaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~--l~tl~--------gHs~~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
+.+..+|++|..-..+|.+++||+.++. ...++ +..+. .....|.++.+.. +|..|++- .++..
T Consensus 16 ~~l~~~~~~Ll~iT~~G~l~vWnl~~~k-~~~~~~Si~pll~~~~~~~~~~~~~i~~~~lt~-~G~PiV~l----sng~~ 89 (219)
T PF07569_consen 16 SFLECNGSYLLAITSSGLLYVWNLKKGK-AVLPPVSIAPLLNSSPVSDKSSSPNITSCSLTS-NGVPIVTL----SNGDS 89 (219)
T ss_pred EEEEeCCCEEEEEeCCCeEEEEECCCCe-eccCCccHHHHhcccccccCCCCCcEEEEEEcC-CCCEEEEE----eCCCE
Confidence 4467889999999999999999999863 11111 11111 3557788888886 99999874 35678
Q ss_pred EEeeC
Q 000080 2347 VVWDT 2351 (2389)
Q Consensus 2347 rLWD~ 2351 (2389)
-.||.
T Consensus 90 y~y~~ 94 (219)
T PF07569_consen 90 YSYSP 94 (219)
T ss_pred EEecc
Confidence 88986
No 403
>KOG4441 consensus Proteins containing BTB/POZ and Kelch domains, involved in regulatory/signal transduction processes [Signal transduction mechanisms; General function prediction only]
Probab=41.24 E-value=2.4e+02 Score=38.51 Aligned_cols=136 Identities=11% Similarity=0.121 Sum_probs=72.0
Q ss_pred eeccccccccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCC------CcEEEeecCCCceeeEecccCCCCCCCCCC
Q 000080 2197 SALGWETQDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSN------THIYLWEFGKDKATATYGVLPAANVPPPYA 2270 (2389)
Q Consensus 2197 sg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~D------gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH 2270 (2389)
+..-||...+.|....+...... -.++++. +|.++++||.| .++..+|..+++=.. . ..|..+.+
T Consensus 302 ~ve~yd~~~~~w~~~a~m~~~r~--~~~~~~~-~~~lYv~GG~~~~~~~l~~ve~YD~~~~~W~~-~-----a~M~~~R~ 372 (571)
T KOG4441|consen 302 SVECYDPKTNEWSSLAPMPSPRC--RVGVAVL-NGKLYVVGGYDSGSDRLSSVERYDPRTNQWTP-V-----APMNTKRS 372 (571)
T ss_pred eeEEecCCcCcEeecCCCCcccc--cccEEEE-CCEEEEEccccCCCcccceEEEecCCCCceec-c-----CCccCccc
Confidence 34456666666655422222111 1233444 46899999999 467788887665211 1 11222222
Q ss_pred CCCEEEEEECCCCCEEEEEeCCCc-----EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCC--
Q 000080 2271 LASISALQFDHYGHRFASAALDGT-----VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNG-- 2343 (2389)
Q Consensus 2271 ~~~V~sVaFSPDG~~LASgS~DgT-----VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D-- 2343 (2389)
...|. .-+|...|.|+.||. |-.||.++.. -............++--.-+|.+.|.||.+...
T Consensus 373 ~~~v~----~l~g~iYavGG~dg~~~l~svE~YDp~~~~------W~~va~m~~~r~~~gv~~~~g~iYi~GG~~~~~~~ 442 (571)
T KOG4441|consen 373 DFGVA----VLDGKLYAVGGFDGEKSLNSVECYDPVTNK------WTPVAPMLTRRSGHGVAVLGGKLYIIGGGDGSSNC 442 (571)
T ss_pred cceeE----EECCEEEEEeccccccccccEEEecCCCCc------ccccCCCCcceeeeEEEEECCEEEEEcCcCCCccc
Confidence 22332 238999999999965 5566666531 011111111222222222268999998855444
Q ss_pred -CeEEEeeC
Q 000080 2344 -INVVVWDT 2351 (2389)
Q Consensus 2344 -~TVrLWD~ 2351 (2389)
++|..+|.
T Consensus 443 l~sve~YDP 451 (571)
T KOG4441|consen 443 LNSVECYDP 451 (571)
T ss_pred cceEEEEcC
Confidence 56777775
No 404
>PF03178 CPSF_A: CPSF A subunit region; InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=39.61 E-value=8.3e+02 Score=30.29 Aligned_cols=98 Identities=17% Similarity=0.236 Sum_probs=63.0
Q ss_pred CeeEEEEcCCCCCCCcEEEecCCeEEEEeeCCCCCCCCccceeeEEecccceEEEEeecCCCCeEEEEecc--eEEe--e
Q 000080 96 PVTSISWSPETPSIGQLAAASENCIFVFAHDSASSKGSFCWSQNAILVQGTKVEAIEWTGSGDGIVAGGME--TVLW--K 171 (2389)
Q Consensus 96 dVk~VaWSPd~~~~GeIaASyDntIRVw~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSpdG~rLaSggdD--V~IW--~ 171 (2389)
+|.+++=-- |.|+++.++.|.+|+-+. .+ .+...+.......|.+|..- +++|+.|.-. +.+. +
T Consensus 90 ~V~ai~~~~-----~~lv~~~g~~l~v~~l~~----~~-~l~~~~~~~~~~~i~sl~~~--~~~I~vgD~~~sv~~~~~~ 157 (321)
T PF03178_consen 90 PVTAICSFN-----GRLVVAVGNKLYVYDLDN----SK-TLLKKAFYDSPFYITSLSVF--KNYILVGDAMKSVSLLRYD 157 (321)
T ss_dssp -EEEEEEET-----TEEEEEETTEEEEEEEET----TS-SEEEEEEE-BSSSEEEEEEE--TTEEEEEESSSSEEEEEEE
T ss_pred cceEhhhhC-----CEEEEeecCEEEEEEccC----cc-cchhhheecceEEEEEEecc--ccEEEEEEcccCEEEEEEE
Confidence 677776654 679999999999999872 11 47777777666688888777 4577755432 5554 5
Q ss_pred ccCCcEEEEEEeeccccceEEEEeecCCCc-eEeeec
Q 000080 172 KKNTLWEIAWKFKENYPQNLVSATWSIEGP-SATAAS 207 (2389)
Q Consensus 172 ~~~s~Wecvwt~~~~~~~~ivsvaWSpdG~-fATag~ 207 (2389)
.....-+.+.+ ...+..+.++..-+|+. ++.+-.
T Consensus 158 ~~~~~l~~va~--d~~~~~v~~~~~l~d~~~~i~~D~ 192 (321)
T PF03178_consen 158 EENNKLILVAR--DYQPRWVTAAEFLVDEDTIIVGDK 192 (321)
T ss_dssp TTTE-EEEEEE--ESS-BEEEEEEEE-SSSEEEEEET
T ss_pred ccCCEEEEEEe--cCCCccEEEEEEecCCcEEEEEcC
Confidence 54445666654 45577788887777775 555544
No 405
>KOG4649 consensus PQQ (pyrrolo-quinoline quinone) repeat protein [Secondary metabolites biosynthesis, transport and catabolism]
Probab=37.41 E-value=2.2e+02 Score=35.50 Aligned_cols=71 Identities=15% Similarity=0.252 Sum_probs=54.4
Q ss_pred CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCE-EEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCc
Q 000080 2230 LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASI-SALQFDHYGHRFASAALDGTVCTWQLEVGGRSNV 2308 (2389)
Q Consensus 2230 dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V-~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~ 2308 (2389)
=|.+++-|-..|-+++=++.+|.+...|.-+ ..| .+-+..+||..+-.|+.|++...-|.++.+
T Consensus 62 vgdfVV~GCy~g~lYfl~~~tGs~~w~f~~~-----------~~vk~~a~~d~~~glIycgshd~~~yalD~~~~~---- 126 (354)
T KOG4649|consen 62 VGDFVVLGCYSGGLYFLCVKTGSQIWNFVIL-----------ETVKVRAQCDFDGGLIYCGSHDGNFYALDPKTYG---- 126 (354)
T ss_pred ECCEEEEEEccCcEEEEEecchhheeeeeeh-----------hhhccceEEcCCCceEEEecCCCcEEEecccccc----
Confidence 3778999999999999999999877666421 112 234578999999999999999999998753
Q ss_pred ccceeeee
Q 000080 2309 RPMESCLC 2316 (2389)
Q Consensus 2309 k~l~tl~g 2316 (2389)
++...++
T Consensus 127 -cVykskc 133 (354)
T KOG4649|consen 127 -CVYKSKC 133 (354)
T ss_pred -eEEeccc
Confidence 4555444
No 406
>TIGR03118 PEPCTERM_chp_1 conserved hypothetical protein TIGR03118. This model describes and uncharacterized conserved hypothetical protein. Members are found with the C-terminal putative exosortase interaction domain, PEP-CTERM, in Nitrosospira multiformis, Rhodoferax ferrireducens, Solibacter usitatus Ellin6076, and Acidobacteria bacterium Ellin345. It is found without the PEP-CTERM domain in several other species, including Burkholderia ambifaria, Gloeobacter violaceus PCC 7421, and three copies in the Acanthamoeba polyphaga mimivirus.
Probab=35.92 E-value=4.1e+02 Score=34.12 Aligned_cols=124 Identities=19% Similarity=0.248 Sum_probs=73.5
Q ss_pred cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecC------CCce-eeEecccCCCCCCCCC--CCCCEEEEEECCCCC---
Q 000080 2217 VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFG------KDKA-TATYGVLPAANVPPPY--ALASISALQFDHYGH--- 2284 (2389)
Q Consensus 2217 v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~------tGk~-l~Tl~vl~gh~~p~~G--H~~~V~sVaFSPDG~--- 2284 (2389)
+.|- |.|+|+|.+++-++...-++..|+|.. .++. +.+. |+. ++ ..+..+.+.|+.-..
T Consensus 22 L~N~--WGia~~p~~~~WVadngT~~~TlYdg~~~~~~g~~~~L~vti---P~~----~~~~~~~~PTGiVfN~~~~F~v 92 (336)
T TIGR03118 22 LRNA--WGLSYRPGGPFWVANTGTGTATLYVGNPDTQPLVQDPLVVVI---PAP----PPLAAEGTPTGQVFNGSDTFVV 92 (336)
T ss_pred cccc--ceeEecCCCCEEEecCCcceEEeecCCcccccCCccceEEEe---cCC----CCCCCCCCccEEEEeCCCceEE
Confidence 4455 889999999999988888999999985 2222 2222 221 11 124578888884433
Q ss_pred ---------EEEEEeCCCcEEEeeCCCCCccCcccceeeee-cCCCee-EEEEecC-CCCEEEEeecCCCCCeEEEeeC
Q 000080 2285 ---------RFASAALDGTVCTWQLEVGGRSNVRPMESCLC-FSSHAM-DVSYITS-SGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2285 ---------~LASgS~DgTVkLWDl~tggrs~~k~l~tl~g-Hs~~V~-sVAFSP~-DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
.|.-+++||||.=|.-..+.......+..... -.+.|+ .+|+-+. .+.+|-.+-+ ..++|.+.|-
T Consensus 93 t~~g~~~~a~Fif~tEdGTisaW~p~v~~t~~~~~~~~~d~s~~gavYkGLAi~~~~~~~~LYaadF--~~g~IDVFd~ 169 (336)
T TIGR03118 93 SGEGITGPSRFLFVTEDGTLSGWAPALGTTRMTRAEIVVDASQQGNVYKGLAVGPTGGGDYLYAANF--RQGRIDVFKG 169 (336)
T ss_pred cCCCcccceeEEEEeCCceEEeecCcCCcccccccEEEEccCCCcceeeeeEEeecCCCceEEEecc--CCCceEEecC
Confidence 36788999999999865531000011111211 124555 3555431 2455554444 6788999995
No 407
>PF14583 Pectate_lyase22: Oligogalacturonate lyase; PDB: 3C5M_C 3PE7_A.
Probab=34.13 E-value=4.2e+02 Score=34.85 Aligned_cols=130 Identities=13% Similarity=0.084 Sum_probs=61.3
Q ss_pred eccccccc-cccccc-cCC------CCcCceeEEEEEEcCCCCeEEE-----EeCCCcEEEeecCCCceeeEecccCCCC
Q 000080 2198 ALGWETQD-DFEDYV-DPP------ATVENISTRAFSSHPLRPFFLV-----GSSNTHIYLWEFGKDKATATYGVLPAAN 2264 (2389)
Q Consensus 2198 g~~~d~~~-~~~~~~-d~~------atv~ni~VrsVAFsPdG~~LAS-----GS~DgTIRLWDl~tGk~l~Tl~vl~gh~ 2264 (2389)
| .|+..+ |+|-.. |.. +..++..+--=-|.|||..|.- |+.+..|.=.|..+++.....+
T Consensus 209 G-pw~~Vd~RiW~i~~dg~~~~~v~~~~~~e~~gHEfw~~DG~~i~y~~~~~~~~~~~i~~~d~~t~~~~~~~~------ 281 (386)
T PF14583_consen 209 G-PWDLVDQRIWTINTDGSNVKKVHRRMEGESVGHEFWVPDGSTIWYDSYTPGGQDFWIAGYDPDTGERRRLME------ 281 (386)
T ss_dssp S--TTTSS-SEEEEETTS---EESS---TTEEEEEEEE-TTSS-EEEEEEETTT--EEEEEE-TTT--EEEEEE------
T ss_pred C-CcceeceEEEEEEcCCCcceeeecCCCCcccccccccCCCCEEEEEeecCCCCceEEEeeCCCCCCceEEEe------
Confidence 5 788876 888663 111 1111223333468899985443 3456678888888887544332
Q ss_pred CCCCCCCCCEEEEEECCCCCEEEEEeCCC----------------cEEEeeCCCCCccCcccceeeeecC---------C
Q 000080 2265 VPPPYALASISALQFDHYGHRFASAALDG----------------TVCTWQLEVGGRSNVRPMESCLCFS---------S 2319 (2389)
Q Consensus 2265 ~p~~GH~~~V~sVaFSPDG~~LASgS~Dg----------------TVkLWDl~tggrs~~k~l~tl~gHs---------~ 2319 (2389)
| .+-.-.--|+||+++|.=+.|. -|.|++++.+. ...+.-|. .
T Consensus 282 ~------p~~~H~~ss~Dg~L~vGDG~d~p~~v~~~~~~~~~~~p~i~~~~~~~~~------~~~l~~h~~sw~v~~~~~ 349 (386)
T PF14583_consen 282 M------PWCSHFMSSPDGKLFVGDGGDAPVDVADAGGYKIENDPWIYLFDVEAGR------FRKLARHDTSWKVLDGDR 349 (386)
T ss_dssp E-------SEEEEEE-TTSSEEEEEE-------------------EEEEEETTTTE------EEEEEE-------BTTBS
T ss_pred C------CceeeeEEcCCCCEEEecCCCCCccccccccceecCCcEEEEeccccCc------eeeeeeccCcceeecCCC
Confidence 1 2234455679999997755542 45678888652 11111121 1
Q ss_pred C--eeEEEEecCCCCEEEEeecCCCCCeEEEe
Q 000080 2320 H--AMDVSYITSSGSVIAAAGHSSNGINVVVW 2349 (2389)
Q Consensus 2320 ~--V~sVAFSP~DGslLASAG~sS~D~TVrLW 2349 (2389)
. -.-+.|+| ||+.|.-.+ ...|..-|+
T Consensus 350 q~~hPhp~FSP-Dgk~VlF~S--d~~G~~~vY 378 (386)
T PF14583_consen 350 QVTHPHPSFSP-DGKWVLFRS--DMEGPPAVY 378 (386)
T ss_dssp STT----EE-T-TSSEEEEEE---TTSS-EEE
T ss_pred ccCCCCCccCC-CCCEEEEEC--CCCCCccEE
Confidence 1 12478999 889888653 344444443
No 408
>PF13449 Phytase-like: Esterase-like activity of phytase
Probab=33.01 E-value=6.2e+02 Score=31.94 Aligned_cols=156 Identities=12% Similarity=0.051 Sum_probs=84.7
Q ss_pred EEEEEcCCCCeEEEEeCCCc------EEEeecCC--C--ceeeEec--ccCCCC-CCCCCCCCCEEEEEECCCCCEEEEE
Q 000080 2223 RAFSSHPLRPFFLVGSSNTH------IYLWEFGK--D--KATATYG--VLPAAN-VPPPYALASISALQFDHYGHRFASA 2289 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgT------IRLWDl~t--G--k~l~Tl~--vl~gh~-~p~~GH~~~V~sVaFSPDG~~LASg 2289 (2389)
..|++.|++..+++-|+++. +...++.. + ..+.... .+.+.+ .|..+-....-+|++.++|.++.|-
T Consensus 23 Sgl~~~~~~~~~~avSD~g~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~L~~~~G~~~~~~~~D~Egi~~~~~g~~~is~ 102 (326)
T PF13449_consen 23 SGLDYDPDDGRFYAVSDRGPNKGPPRFYTFRIDYDQGGIGGVTILDMIPLRDPDGQPFPKNGLDPEGIAVPPDGSFWISS 102 (326)
T ss_pred eeEEEeCCCCEEEEEECCCCCCCCCcEEEEEeeccCCCccceEeccceeccCCCCCcCCcCCCChhHeEEecCCCEEEEe
Confidence 67788866666666788888 66666543 1 1111110 011100 0100011245689998999988888
Q ss_pred eCC------CcEEEeeCCCCCccCcccc-----e-------eeeecCCCeeEEEEecCCCCEEEEeecCC--CCC-----
Q 000080 2290 ALD------GTVCTWQLEVGGRSNVRPM-----E-------SCLCFSSHAMDVSYITSSGSVIAAAGHSS--NGI----- 2344 (2389)
Q Consensus 2290 S~D------gTVkLWDl~tggrs~~k~l-----~-------tl~gHs~~V~sVAFSP~DGslLASAG~sS--~D~----- 2344 (2389)
-.+ -.|.-.+.. | + ..+.+ . .-...+....++|++| ||+.|.++--+. .|+
T Consensus 103 E~~~~~~~~p~I~~~~~~-G-~-~~~~~~vP~~~~~~~~~~~~~~~N~G~E~la~~~-dG~~l~~~~E~~l~~d~~~~~~ 178 (326)
T PF13449_consen 103 EGGRTGGIPPRIRRFDLD-G-R-VIRRFPVPAAFLPDANGTSGRRNNRGFEGLAVSP-DGRTLFAAMESPLKQDGPRANP 178 (326)
T ss_pred CCccCCCCCCEEEEECCC-C-c-ccceEccccccccccCccccccCCCCeEEEEECC-CCCEEEEEECccccCCCccccc
Confidence 888 777777765 3 2 11111 0 1122456677999999 889444331111 121
Q ss_pred ----eEEEeeCCCCC-CCce----EEEEe-----ecCcEEEEeecccchhhh
Q 000080 2345 ----NVVVWDTLAPP-TSSR----ASITC-----HEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus 2345 ----TVrLWD~l~~t-g~~v----~sL~G-----H~~~V~svA~~~~~~~~~ 2382 (2389)
.+||+.....+ ++.. ..+.. ...++..++..+++++.+
T Consensus 179 ~~~~~~ri~~~d~~~~~~~~~~~~y~ld~~~~~~~~~~isd~~al~d~~lLv 230 (326)
T PF13449_consen 179 DNGSPLRILRYDPKTPGEPVAEYAYPLDPPPTAPGDNGISDIAALPDGRLLV 230 (326)
T ss_pred ccCceEEEEEecCCCCCccceEEEEeCCccccccCCCCceeEEEECCCcEEE
Confidence 27787764333 2222 33332 456788888888887543
No 409
>PF08728 CRT10: CRT10; InterPro: IPR014839 CRT10 is a transcriptional regulator of ribonucleotide reductase (RNR) genes []. RNR catalyses the rate limiting step in dNTP synthesis. Mutations in CRT10 have been shown to enhance hydroxyurea resistance [].
Probab=32.89 E-value=2.4e+02 Score=39.43 Aligned_cols=114 Identities=12% Similarity=0.075 Sum_probs=71.0
Q ss_pred CCCCeEEEEeCCCcEEEeecC-------CC----ce-eeEecccCCCCCCCCCCCCCEEEEEEC--CCCCEEEEEeCCCc
Q 000080 2229 PLRPFFLVGSSNTHIYLWEFG-------KD----KA-TATYGVLPAANVPPPYALASISALQFD--HYGHRFASAALDGT 2294 (2389)
Q Consensus 2229 PdG~~LASGS~DgTIRLWDl~-------tG----k~-l~Tl~vl~gh~~p~~GH~~~V~sVaFS--PDG~~LASgS~DgT 2294 (2389)
-+...|+.+.+||.|-+|.+. .. +. .....+.|.- .......++++++. ...+.||.++.-..
T Consensus 112 g~~EVLl~c~DdG~V~~Yyt~~I~~~i~~~~~~~~~~~~r~~i~P~f---~~~v~~SaWGLdIh~~~~~rlIAVSsNs~~ 188 (717)
T PF08728_consen 112 GGEEVLLLCTDDGDVLAYYTETIIEAIERFSEDNDSGFSRLKIKPFF---HLRVGASAWGLDIHDYKKSRLIAVSSNSQE 188 (717)
T ss_pred CCeeEEEEEecCCeEEEEEHHHHHHHHHhhccccccccccccCCCCe---EeecCCceeEEEEEecCcceEEEEecCCce
Confidence 345589999999999999652 00 00 0000000000 00112579999998 77899999999999
Q ss_pred EEEeeCCCC-CccCcccceeeeecCCCeeEEEEecCC----CC-EEEEeecCCCCCeEEEeeC
Q 000080 2295 VCTWQLEVG-GRSNVRPMESCLCFSSHAMDVSYITSS----GS-VIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2295 VkLWDl~tg-grs~~k~l~tl~gHs~~V~sVAFSP~D----Gs-lLASAG~sS~D~TVrLWD~ 2351 (2389)
|.|+-.... .+ .....-..|..-|.+|+|.+++ |. .|+++ +-.|+|.+|++
T Consensus 189 VTVFaf~l~~~r---~~~~~s~~~~hNIP~VSFl~~~~d~~G~v~v~a~---dI~G~v~~~~I 245 (717)
T PF08728_consen 189 VTVFAFALVDER---FYHVPSHQHSHNIPNVSFLDDDLDPNGHVKVVAT---DISGEVWTFKI 245 (717)
T ss_pred EEEEEEeccccc---cccccccccccCCCeeEeecCCCCCccceEEEEE---eccCcEEEEEE
Confidence 999966542 11 1111112367789999999853 32 56554 57888888887
No 410
>KOG4499 consensus Ca2+-binding protein Regucalcin/SMP30 [Inorganic ion transport and metabolism; Signal transduction mechanisms]
Probab=32.06 E-value=6.9e+02 Score=31.24 Aligned_cols=137 Identities=15% Similarity=0.037 Sum_probs=81.2
Q ss_pred EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCE-------EEEEECCCCC-EEEEEeCCCc
Q 000080 2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASI-------SALQFDHYGH-RFASAALDGT 2294 (2389)
Q Consensus 2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V-------~sVaFSPDG~-~LASgS~DgT 2294 (2389)
..-..+|+|++++--=.|-.- ..+.-.|. +... +++|. ..-| ..++++.|.+ +...-|.+-+
T Consensus 112 NDgkvdP~Gryy~GtMad~~~-~le~~~g~-Ly~~--~~~h~------v~~i~~~v~IsNgl~Wd~d~K~fY~iDsln~~ 181 (310)
T KOG4499|consen 112 NDGKVDPDGRYYGGTMADFGD-DLEPIGGE-LYSW--LAGHQ------VELIWNCVGISNGLAWDSDAKKFYYIDSLNYE 181 (310)
T ss_pred ccCccCCCCceeeeeeccccc-cccccccE-EEEe--ccCCC------ceeeehhccCCccccccccCcEEEEEccCceE
Confidence 344689999996532233222 22222222 3333 23442 1222 3567777775 5567788999
Q ss_pred EEEee--CCCCCccCcccceeeee---cCCCe-eEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCc
Q 000080 2295 VCTWQ--LEVGGRSNVRPMESCLC---FSSHA-MDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGL 2368 (2389)
Q Consensus 2295 VkLWD--l~tggrs~~k~l~tl~g---Hs~~V-~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~ 2368 (2389)
|.-|| ..+|.-++.+.+..+.. +.... -..+... +|.+.++. =+.++|.--|. .+|+.++.+.--+.+
T Consensus 182 V~a~dyd~~tG~~snr~~i~dlrk~~~~e~~~PDGm~ID~-eG~L~Va~---~ng~~V~~~dp--~tGK~L~eiklPt~q 255 (310)
T KOG4499|consen 182 VDAYDYDCPTGDLSNRKVIFDLRKSQPFESLEPDGMTIDT-EGNLYVAT---FNGGTVQKVDP--TTGKILLEIKLPTPQ 255 (310)
T ss_pred EeeeecCCCcccccCcceeEEeccCCCcCCCCCCcceEcc-CCcEEEEE---ecCcEEEEECC--CCCcEEEEEEcCCCc
Confidence 99998 77764344344444432 12211 1244455 67766654 26788888887 588889988888999
Q ss_pred EEEEeec
Q 000080 2369 YDLFLPL 2375 (2389)
Q Consensus 2369 V~svA~~ 2375 (2389)
|+|.++-
T Consensus 256 itsccFg 262 (310)
T KOG4499|consen 256 ITSCCFG 262 (310)
T ss_pred eEEEEec
Confidence 9998874
No 411
>KOG3616 consensus Selective LIM binding factor [Transcription]
Probab=30.16 E-value=75 Score=43.34 Aligned_cols=62 Identities=26% Similarity=0.426 Sum_probs=41.7
Q ss_pred EEEEEEcCCCCeEEEEeCCCcEEEeecCCCce--eeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080 2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKA--TATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus 2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~--l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
+.+|.-||-|+-+++|+.||+|+++++..-+. +.+..+ | -..+.|...| |.++..|+.+--|
T Consensus 17 ~~aiqshp~~~s~v~~~~d~si~lfn~~~r~qski~~~~~------p-------~~nlv~tnhg--l~~~tsdrr~la~ 80 (1636)
T KOG3616|consen 17 TTAIQSHPGGQSFVLAHQDGSIILFNFIPRRQSKICEEAK------P-------KENLVFTNHG--LVTATSDRRALAW 80 (1636)
T ss_pred eeeeeecCCCceEEEEecCCcEEEEeecccchhhhhhhcC------C-------ccceeeeccc--eEEEeccchhhee
Confidence 37889999999999999999999999865444 333321 1 1334455555 5555555555555
No 412
>PF14655 RAB3GAP2_N: Rab3 GTPase-activating protein regulatory subunit N-terminus
Probab=30.06 E-value=2.9e+02 Score=36.43 Aligned_cols=32 Identities=16% Similarity=0.076 Sum_probs=28.7
Q ss_pred CCEEEEEECCCCCEEEEEeCCCcEEEeeCCCC
Q 000080 2272 ASISALQFDHYGHRFASAALDGTVCTWQLEVG 2303 (2389)
Q Consensus 2272 ~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tg 2303 (2389)
..+.+|+.+|+|++.|..+.=|.|.|+|+.++
T Consensus 308 R~~~~i~~sP~~~laA~tDslGRV~LiD~~~~ 339 (415)
T PF14655_consen 308 REGESICLSPSGRLAAVTDSLGRVLLIDVARG 339 (415)
T ss_pred ceEEEEEECCCCCEEEEEcCCCcEEEEECCCC
Confidence 45899999999998888888899999999986
No 413
>PF13934 ELYS: Nuclear pore complex assembly
Probab=29.72 E-value=3e+02 Score=33.22 Aligned_cols=160 Identities=17% Similarity=0.136 Sum_probs=92.3
Q ss_pred eChHHHHHHHHHHHHHHHhccCCcchhHHHHHHhcchHHHHHHHhcccCCCchhHHhHhhcccChHHHHHHHHhhHHHHh
Q 000080 1241 TDVTQLRTRMEKLARLQYLKKKDPKDCALLYIALNRIQVLAGLFKISKDEKDKPLVGFLSRNFQEEKNKAAALKNAYVLL 1320 (2389)
Q Consensus 1241 ~~~~~Lr~~~EkIAr~ey~~~kDP~dcaLfYlAL~Kk~vL~gL~k~~~~~k~~~m~~FLsnDFse~RWr~AAlKNAyaLL 1320 (2389)
++.+.||+.+..|....... .-..|-+||+.+--.... .....+=|.+.|.-++--.... -||-+|
T Consensus 24 ~s~~~L~~Ll~~i~~~~~~~--~~K~~l~~YlLlD~~~~~-----------~~~~~~~Fa~~f~ip~~~~~~~-~g~W~L 89 (226)
T PF13934_consen 24 KSDNDLRALLDLILSSNVSL--LKKHSLFYYLLLDLDDTR-----------PSELAESFARAFGIPPKYIKFI-QGFWLL 89 (226)
T ss_pred cCHHHHHHHHHHHhcCCcCH--HHhHHHHHHHHHhcCccc-----------cccHHHHHHHHhCCCHHHHHHH-HHHHHh
Confidence 45566888776654432211 122477788776542110 0113343455555554333322 367777
Q ss_pred hcchhHHHHHHHHhc----CChhHHHHHHHHhcCChhhhhhhhhhhccCCCh-----hhHhhHhhhccccccc-------
Q 000080 1321 GRHQLELAIAFFLLG----GDAASAVTVCARNLGDVQLALVICRLVEKHGGP-----LERNLVTKFILPSSIE------- 1384 (2389)
Q Consensus 1321 sK~Ry~~AAAFFLLA----g~lkDAV~Vc~~~L~D~qLAi~IaRLyEgd~gp-----~l~~lL~~~vLp~a~~------- 1384 (2389)
=...|+.|...+.=. ......+++++.+ ++.++|+...|.....-.. .+..+|.+..+++|..
T Consensus 90 D~~~~~~A~~~L~~ps~~~~~~~~Il~~L~~~-~~~~lAL~y~~~~~p~l~s~~~~~~~~~~La~~~v~EAf~~~R~~~~ 168 (226)
T PF13934_consen 90 DHGDFEEALELLSHPSLIPWFPDKILQALLRR-GDPKLALRYLRAVGPPLSSPEALTLYFVALANGLVTEAFSFQRSYPD 168 (226)
T ss_pred ChHhHHHHHHHhCCCCCCcccHHHHHHHHHHC-CChhHHHHHHHhcCCCCCCHHHHHHHHHHHHcCCHHHHHHHHHhCch
Confidence 777777776665332 2245788888886 8888888888887654221 1234566666666642
Q ss_pred -cCChhHHHHHHHHhCCh--hHHHHHHhcCcccc
Q 000080 1385 -RGDYWLTSLLEWELGNY--SQSFLTMLGFQSTA 1415 (2389)
Q Consensus 1385 -~gDrwL~S~a~W~L~~~--~~Av~~Ll~~p~~~ 1415 (2389)
.+.+-+..++.++++.. ...++.|++.|.++
T Consensus 169 ~~~~~l~e~l~~~~~~~~~~~~~~~~Ll~LPl~~ 202 (226)
T PF13934_consen 169 ELRRRLFEQLLEHCLEECARSGRLDELLSLPLDE 202 (226)
T ss_pred hhhHHHHHHHHHHHHHHhhhhhHHHHHHhCCCCh
Confidence 12346667777777533 45678899888765
No 414
>KOG2395 consensus Protein involved in vacuole import and degradation [Intracellular trafficking, secretion, and vesicular transport]
Probab=27.30 E-value=87 Score=41.83 Aligned_cols=58 Identities=17% Similarity=0.217 Sum_probs=44.1
Q ss_pred eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCC
Q 000080 2233 FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus 2233 ~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~ 2301 (2389)
+||.||.+|.|||+|- .|+.-+|. +|| =...|..|.-+.||+++.... +.++-|=++.
T Consensus 443 ~IvvgS~~GdIRLYdr-i~~~AKTA--lPg-------LG~~I~hVdvtadGKwil~Tc-~tyLlLi~t~ 500 (644)
T KOG2395|consen 443 YIVVGSLKGDIRLYDR-IGRRAKTA--LPG-------LGDAIKHVDVTADGKWILATC-KTYLLLIDTL 500 (644)
T ss_pred eEEEeecCCcEEeehh-hhhhhhhc--ccc-------cCCceeeEEeeccCcEEEEec-ccEEEEEEEe
Confidence 7888999999999995 77766664 233 337899999999999877544 5667766653
No 415
>cd00870 PI3Ka_III Phosphoinositide 3-kinase (PI3K) class III, accessory domain (PIK domain); PIK domain is conserved in all PI3 and PI4-kinases. Its role is unclear but it has been suggested to be involved in substrate presentation. In general, PI3Ks class III phosphorylate phosphoinositol (PtdIns) only. The prototypical PI3K class III, yeast Vps34, is involved in trafficking proteins from Golgi to the vacuole.
Probab=25.88 E-value=3e+02 Score=32.00 Aligned_cols=116 Identities=23% Similarity=0.336 Sum_probs=70.4
Q ss_pred chHHHHHHHhcccCCCchhHHhHhh-cccChHHHHHHHHhhHHHHhhcch-hHHHHHHHHhcCChhH------HHHHHHH
Q 000080 1276 RIQVLAGLFKISKDEKDKPLVGFLS-RNFQEEKNKAAALKNAYVLLGRHQ-LELAIAFFLLGGDAAS------AVTVCAR 1347 (2389)
Q Consensus 1276 Kk~vL~gL~k~~~~~k~~~m~~FLs-nDFse~RWr~AAlKNAyaLLsK~R-y~~AAAFFLLAg~lkD------AV~Vc~~ 1347 (2389)
.|++|+. ||-.--...+.+.+||. =|++++. ..+.||+||.+-. ..-.-|.-||...+.| ||+.+-
T Consensus 30 ek~llW~-~R~~l~~~p~aL~~~L~sv~W~~~~----e~~e~~~lL~~W~~i~~~~aLeLL~~~f~~~~VR~yAV~~L~- 103 (166)
T cd00870 30 EKDLIWK-FRFYLTNNKKALTKFLKSVNWSDEQ----EVKQALELMPKWAKIDIEDALELLSPYFTNPVVRKYAVSRLK- 103 (166)
T ss_pred HHHHHHH-hHHHHhhCcHHHHHHhhhCCCCCHH----HHHHHHHHHhcCCCCCHHHHHHHcCccCCCHHHHHHHHHHHH-
Confidence 3555554 34321111245678873 3555432 5567888887653 3455678888887765 676655
Q ss_pred hcCChhhhhhhhhhh-----ccC---CChhhHhhHhhhccccccccCChhHHHHHHHHhC
Q 000080 1348 NLGDVQLALVICRLV-----EKH---GGPLERNLVTKFILPSSIERGDYWLTSLLEWELG 1399 (2389)
Q Consensus 1348 ~L~D~qLAi~IaRLy-----Egd---~gp~l~~lL~~~vLp~a~~~gDrwL~S~a~W~L~ 1399 (2389)
++.|-+|...+--|. |.. .++....-|.+++|-.|.. ++=++...||.|+
T Consensus 104 ~~sd~eL~~yL~QLVQaLKyE~~~~~~~~~~~s~La~fLl~Ral~--s~~ig~~lfW~Lk 161 (166)
T cd00870 104 LASDEELLLYLLQLVQALKYENLDLSPLPRLDSPLADFLIERALK--NPKLANFLYWYLK 161 (166)
T ss_pred hCCHHHHHHHHHHHHHHHHhcccccccccccccHHHHHHHHHHhc--CHHHHHHHHHHhh
Confidence 589998888776664 432 1122334566666666654 4559999999885
No 416
>KOG2377 consensus Uncharacterized conserved protein [Function unknown]
Probab=25.60 E-value=1.7e+02 Score=38.71 Aligned_cols=30 Identities=17% Similarity=0.133 Sum_probs=28.1
Q ss_pred CCEEEEEECCCCCEEEEEeCCCcEEEeeCC
Q 000080 2272 ASISALQFDHYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus 2272 ~~V~sVaFSPDG~~LASgS~DgTVkLWDl~ 2301 (2389)
+.|.+|.||||.+.||.--.|++|.+.+..
T Consensus 67 G~I~SIkFSlDnkilAVQR~~~~v~f~nf~ 96 (657)
T KOG2377|consen 67 GEIKSIKFSLDNKILAVQRTSKTVDFCNFI 96 (657)
T ss_pred CceeEEEeccCcceEEEEecCceEEEEecC
Confidence 579999999999999999999999999883
No 417
>PF10313 DUF2415: Uncharacterised protein domain (DUF2415); InterPro: IPR019417 This entry represents a short (30 residues) domain of unknown function found in a family of fungal proteins. It contains a characteristic DLL sequence motif.
Probab=25.36 E-value=1.3e+02 Score=28.16 Aligned_cols=31 Identities=6% Similarity=0.105 Sum_probs=25.7
Q ss_pred eEEEEEEcCCC---CeEEEEeCCCcEEEeecCCC
Q 000080 2221 STRAFSSHPLR---PFFLVGSSNTHIYLWEFGKD 2251 (2389)
Q Consensus 2221 ~VrsVAFsPdG---~~LASGS~DgTIRLWDl~tG 2251 (2389)
.||.+.|+|+. .+||-+=.-+.|-|+|++++
T Consensus 2 AvR~~kFsP~~~~~DLL~~~E~~g~vhi~D~R~~ 35 (43)
T PF10313_consen 2 AVRCCKFSPEPGGNDLLAWAEHQGRVHIVDTRSN 35 (43)
T ss_pred CeEEEEeCCCCCcccEEEEEccCCeEEEEEcccC
Confidence 46999999854 48888888899999999854
No 418
>PF11715 Nup160: Nucleoporin Nup120/160; InterPro: IPR021717 Nup120 is conserved from fungi to plants to humans, and is homologous with the Nup160 of vertebrates. The nuclear core complex, or NPC, mediates macromolecular transport across the nuclear envelope. Deletion of the NUP120 gene causes clustering of NPCs at one side of the nuclear envelope, moderate nucleolar fragmentation and slower cell growth []. The vertebrate NPC is estimated to contain between 30 and 60 different proteins. most of which are not known. Two important ones in creating the nucleoporin basket are Nup98 and Nup153, and Nup120, in conjunction with Nup 133, interacts with these two and itself plays a role in mRNA export []. Nup160, Nup133, Nup96, and Nup107 are all targets of phosphorylation. The phosphorylation sites are clustered mainly at the N-terminal regions of these proteins, which are predicted to be natively disordered. The entire Nup107-160 subcomplex is stable throughout the cell cycle, thus it seems unlikely that phosphorylation affects interactions within the Nup107-160 subcomplex, but rather that it regulates the association of the subcomplex with the NPC and other proteins []. ; PDB: 3F7F_D 3H7N_D 3HXR_A.
Probab=25.15 E-value=1e+02 Score=40.97 Aligned_cols=33 Identities=21% Similarity=0.313 Sum_probs=25.2
Q ss_pred CCEEEEEECC----CCCEEEEEeCCCcEEEeeCCCCC
Q 000080 2272 ASISALQFDH----YGHRFASAALDGTVCTWQLEVGG 2304 (2389)
Q Consensus 2272 ~~V~sVaFSP----DG~~LASgS~DgTVkLWDl~tgg 2304 (2389)
+.+.++++++ +...+++.+.|+++|+||++++.
T Consensus 215 ~~~~~~~~~~~~~~~~~~l~tl~~D~~LRiW~l~t~~ 251 (547)
T PF11715_consen 215 SVAASLAVSSSEINDDTFLFTLSRDHTLRIWSLETGQ 251 (547)
T ss_dssp --EEEEEE-----ETTTEEEEEETTSEEEEEETTTTC
T ss_pred CccceEEEecceeCCCCEEEEEeCCCeEEEEECCCCe
Confidence 3466677777 67899999999999999999873
No 419
>KOG4659 consensus Uncharacterized conserved protein (Rhs family) [Function unknown]
Probab=24.84 E-value=2.8e+02 Score=40.79 Aligned_cols=16 Identities=19% Similarity=0.295 Sum_probs=7.1
Q ss_pred cccccCceEEEEecCe
Q 000080 894 FTWGRRAIAIVVHQSY 909 (2389)
Q Consensus 894 ssWVRDGILVVGmgnE 909 (2389)
+.-.+||-|.||--|.
T Consensus 370 la~a~DGSl~VGDfNy 385 (1899)
T KOG4659|consen 370 LAYAPDGSLIVGDFNY 385 (1899)
T ss_pred EEEcCCCcEEEccchh
Confidence 3444444444444444
No 420
>KOG3616 consensus Selective LIM binding factor [Transcription]
Probab=24.31 E-value=2e+02 Score=39.69 Aligned_cols=134 Identities=20% Similarity=0.266 Sum_probs=76.4
Q ss_pred HhhcchhHHHHHHHHhcCChhHHHHHHHHhcCChhhhhhhhhhhccCCChhhHhhHhhhccccccccCChhHHHHHHHH-
Q 000080 1319 LLGRHQLELAIAFFLLGGDAASAVTVCARNLGDVQLALVICRLVEKHGGPLERNLVTKFILPSSIERGDYWLTSLLEWE- 1397 (2389)
Q Consensus 1319 LLsK~Ry~~AAAFFLLAg~lkDAV~Vc~~~L~D~qLAi~IaRLyEgd~gp~l~~lL~~~vLp~a~~~gDrwL~S~a~W~- 1397 (2389)
||.-+|-..|.-+|+=|+-.-||+.+|-+||.. |+ -+|.--| ++.-+....+.-|-|.+---.|.
T Consensus 1102 llrankp~i~l~yf~e~~lw~dalri~kdylp~-q~-a~iqeey------------ek~~~k~gargvd~fvaqak~weq 1167 (1636)
T KOG3616|consen 1102 LLRANKPDIALNYFIEAELWPDALRIAKDYLPH-QA-AAIQEEY------------EKEALKKGARGVDGFVAQAKEWEQ 1167 (1636)
T ss_pred eeecCCCchHHHHHHHhccChHHHHHHHhhChh-HH-HHHHHHH------------HHHHHhccccccHHHHHHHHHHHh
Confidence 556666667777777777777777777777654 22 2222223 22233334444466888777885
Q ss_pred hCChhHHHHHHhcCccccccccccccCCCccCCChHHHHHHHHhhccccchhhhccchhhhhHHHHHHHHHH-HHHhcCC
Q 000080 1398 LGNYSQSFLTMLGFQSTAVINNFALSSNSVAFMDPSIGLYCLMLANKNSMRNAIGEKNAAILGRWAALMRAT-ALNRCGL 1476 (2389)
Q Consensus 1398 L~~~~~Av~~Ll~~p~~~~~~~s~l~s~~~~f~DPaL~l~~~~L~sk~~~r~~~g~~~~~~~~r~~~l~~a~-~l~RmGC 1476 (2389)
-|++..||.+||+...+. ++.-+|+-.|..-+..-+++-..|..+ -+++..|- +|+..||
T Consensus 1168 ~gd~rkav~~~lkinrds-------------t~nd~l~e~~~~kaadl~ikfl~~d~n------me~i~aa~~al~~~~~ 1228 (1636)
T KOG3616|consen 1168 AGDWRKAVDALLKINRDS-------------TDNDALAEHCTEKAADLSIKFLMGDEN------MEVIGAAGGALDEAGC 1228 (1636)
T ss_pred cccHHHHHHHHhhhccCC-------------CCcHHHHHHHHHHHHhhhhhhcCCccc------hhhHHhcchhhhcccc
Confidence 699999999999754322 233344444433222222333334222 23344333 3788999
Q ss_pred Chhhhhccc
Q 000080 1477 PLEALDCLS 1485 (2389)
Q Consensus 1477 ~lLALdll~ 1485 (2389)
+--|-||+-
T Consensus 1229 ~e~aael~l 1237 (1636)
T KOG3616|consen 1229 HEAAAELLL 1237 (1636)
T ss_pred cHHHHHHHH
Confidence 987777764
No 421
>KOG1897 consensus Damage-specific DNA binding complex, subunit DDB1 [Replication, recombination and repair]
Probab=23.49 E-value=4.1e+02 Score=38.32 Aligned_cols=150 Identities=12% Similarity=0.035 Sum_probs=0.0
Q ss_pred eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCcee--------eEecccCCCCCCCCCCCCCEEEEEECCC-CCEEEEEeC
Q 000080 2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKAT--------ATYGVLPAANVPPPYALASISALQFDHY-GHRFASAAL 2291 (2389)
Q Consensus 2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l--------~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~ 2291 (2389)
+.|+|++++...+++.-+.-...+.=..+....+ .||+++..|..-..-..-.|.++.|.-| +.+++.|..
T Consensus 716 ~prrI~~q~~sl~~~v~s~r~e~~~~~~~ee~~~s~l~vlD~nTf~vl~~hef~~~E~~~Si~s~~~~~d~~t~~vVGT~ 795 (1096)
T KOG1897|consen 716 SPRRICYQESSLTFGVLSNRIESSAEYYGEEYEVSFLRVLDQNTFEVLSSHEFERNETALSIISCKFTDDPNTYYVVGTG 795 (1096)
T ss_pred ChhheEecccceEEEEEecccccchhhcCCcceEEEEEEecCCceeEEeeccccccceeeeeeeeeecCCCceEEEEEEE
Q ss_pred ----------CCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEE
Q 000080 2292 ----------DGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRAS 2361 (2389)
Q Consensus 2292 ----------DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~s 2361 (2389)
.|.|-+...+.+ +.++....|.-...-.+..--+|++||. -+..|||++. .+.+.++.
T Consensus 796 ~v~Pde~ep~~GRIivfe~~e~-----~~L~~v~e~~v~Gav~aL~~fngkllA~-----In~~vrLye~--t~~~eLr~ 863 (1096)
T KOG1897|consen 796 LVYPDENEPVNGRIIVFEFEEL-----NSLELVAETVVKGAVYALVEFNGKLLAG-----INQSVRLYEW--TTERELRI 863 (1096)
T ss_pred eeccCCCCcccceEEEEEEecC-----CceeeeeeeeeccceeehhhhCCeEEEe-----cCcEEEEEEc--cccceehh
Q ss_pred EEeecCcEEEEeecccchhhh
Q 000080 2362 ITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus 2362 L~GH~~~V~svA~~~~~~~~~ 2382 (2389)
=..|.+.+..+.....||++.
T Consensus 864 e~~~~~~~~aL~l~v~gdeI~ 884 (1096)
T KOG1897|consen 864 ECNISNPIIALDLQVKGDEIA 884 (1096)
T ss_pred hhcccCCeEEEEEEecCcEEE
No 422
>PRK11447 cellulose synthase subunit BcsC; Provisional
Probab=23.25 E-value=6.9e+02 Score=36.87 Aligned_cols=77 Identities=12% Similarity=0.122 Sum_probs=44.9
Q ss_pred HHhcCChhHHHHHHHHhcCChhhhhhhhhhhccCCChhh-HhhHhhhccccccccCCh-hHHHHHHHHhCChhHHHHHHh
Q 000080 1332 FLLGGDAASAVTVCARNLGDVQLALVICRLVEKHGGPLE-RNLVTKFILPSSIERGDY-WLTSLLEWELGNYSQSFLTML 1409 (2389)
Q Consensus 1332 FLLAg~lkDAV~Vc~~~L~D~qLAi~IaRLyEgd~gp~l-~~lL~~~vLp~a~~~gDr-wL~S~a~W~L~~~~~Av~~Ll 1409 (2389)
.+-.|+.++|++++-++-.+.++-+.++.+|+..+..-. ...+ +.++...-...+. .-...+|..+|++++|++.+-
T Consensus 583 l~~~G~~~eA~~~l~~~p~~~~~~~~La~~~~~~g~~~~A~~~y-~~al~~~P~~~~a~~~la~~~~~~g~~~eA~~~l~ 661 (1157)
T PRK11447 583 LRDSGKEAEAEALLRQQPPSTRIDLTLADWAQQRGDYAAARAAY-QRVLTREPGNADARLGLIEVDIAQGDLAAARAQLA 661 (1157)
T ss_pred HHHCCCHHHHHHHHHhCCCCchHHHHHHHHHHHcCCHHHHHHHH-HHHHHhCCCCHHHHHHHHHHHHHCCCHHHHHHHHH
Confidence 344567778888777777777777777777765332111 1112 2222222222232 334456889999999997665
No 423
>PRK10370 formate-dependent nitrite reductase complex subunit NrfG; Provisional
Probab=23.19 E-value=5.3e+02 Score=30.32 Aligned_cols=74 Identities=15% Similarity=0.178 Sum_probs=41.4
Q ss_pred CChhHHHHHHHHhc----CChhhhhhhhhh-h-ccCC--ChhhHhhHhhhccccccccCChhHHHHHHHHhCChhHHHHH
Q 000080 1336 GDAASAVTVCARNL----GDVQLALVICRL-V-EKHG--GPLERNLVTKFILPSSIERGDYWLTSLLEWELGNYSQSFLT 1407 (2389)
Q Consensus 1336 g~lkDAV~Vc~~~L----~D~qLAi~IaRL-y-Egd~--gp~l~~lL~~~vLp~a~~~gDrwL~S~a~W~L~~~~~Av~~ 1407 (2389)
|+.++|+..+-+=+ +|.++...++.+ | ..++ .+--.+++++.+--....-.-.++...++-.+|+|++|+..
T Consensus 87 g~~~~A~~a~~~Al~l~P~~~~~~~~lA~aL~~~~g~~~~~~A~~~l~~al~~dP~~~~al~~LA~~~~~~g~~~~Ai~~ 166 (198)
T PRK10370 87 NDYDNALLAYRQALQLRGENAELYAALATVLYYQAGQHMTPQTREMIDKALALDANEVTALMLLASDAFMQADYAQAIEL 166 (198)
T ss_pred CCHHHHHHHHHHHHHhCCCCHHHHHHHHHHHHHhcCCCCcHHHHHHHHHHHHhCCCChhHHHHHHHHHHHcCCHHHHHHH
Confidence 44555555444322 366666666653 2 3222 13345555554433222223357888888999999999976
Q ss_pred Hh
Q 000080 1408 ML 1409 (2389)
Q Consensus 1408 Ll 1409 (2389)
+-
T Consensus 167 ~~ 168 (198)
T PRK10370 167 WQ 168 (198)
T ss_pred HH
Confidence 53
No 424
>PF05787 DUF839: Bacterial protein of unknown function (DUF839); InterPro: IPR008557 This family consists of bacterial proteins of unknown function.
Probab=22.67 E-value=7.2e+02 Score=33.84 Aligned_cols=57 Identities=28% Similarity=0.499 Sum_probs=33.2
Q ss_pred cCCCCchhhh--hcccceeeeeeccc------CCCcceEEeecccceEEeeecccccccccccceec
Q 000080 2068 IPFQAPKEIC--KRNGELFEALCVNS------IDQRQGAIASNRKGIVFFNLEDEIPLHDQLKYIWA 2126 (2389)
Q Consensus 2068 ~~f~~~~~~~--~~~~~~~~a~~~n~------~n~~~~~~a~~~k~~~~~~~~~~~~~~~~~~~~~~ 2126 (2389)
+.|.+|+-|. ..+|++--|+.=|+ ++.... .+.|+-|.||- |.....-.....+.|.
T Consensus 347 T~f~RpEgi~~~p~~g~vY~a~T~~~~r~~~~~~~~n~-~~~n~~G~I~r-~~~~~~d~~~~~f~~~ 411 (524)
T PF05787_consen 347 TPFDRPEGITVNPDDGEVYFALTNNSGRGESDVDAANP-RAGNGYGQIYR-YDPDGNDHAATTFTWE 411 (524)
T ss_pred ccccCccCeeEeCCCCEEEEEEecCCCCcccccccCCc-ccCCcccEEEE-ecccCCccccceeEEE
Confidence 5799999887 88888888887666 111111 25577787743 3333322233335554
No 425
>PRK10115 protease 2; Provisional
Probab=22.62 E-value=4.4e+02 Score=36.79 Aligned_cols=101 Identities=7% Similarity=-0.053 Sum_probs=57.4
Q ss_pred CCEEEEEECCCCCEEEEEeC-----CCcEEEeeCCCCCccCcccc-eeeeecCCCeeEEEEecCCCCEEEEeecCC---C
Q 000080 2272 ASISALQFDHYGHRFASAAL-----DGTVCTWQLEVGGRSNVRPM-ESCLCFSSHAMDVSYITSSGSVIAAAGHSS---N 2342 (2389)
Q Consensus 2272 ~~V~sVaFSPDG~~LASgS~-----DgTVkLWDl~tggrs~~k~l-~tl~gHs~~V~sVAFSP~DGslLASAG~sS---~ 2342 (2389)
-.+..+.+||||++||-+.+ .-+|++=|+.+|. .+ ..+. ..-..++|.+ ||+.|.-+.... .
T Consensus 127 ~~l~~~~~Spdg~~la~~~d~~G~E~~~l~v~d~~tg~-----~l~~~i~---~~~~~~~w~~-D~~~~~y~~~~~~~~~ 197 (686)
T PRK10115 127 YTLGGMAITPDNTIMALAEDFLSRRQYGIRFRNLETGN-----WYPELLD---NVEPSFVWAN-DSWTFYYVRKHPVTLL 197 (686)
T ss_pred EEEeEEEECCCCCEEEEEecCCCcEEEEEEEEECCCCC-----CCCcccc---CcceEEEEee-CCCEEEEEEecCCCCC
Confidence 34677899999998887543 3567788888762 11 1111 1124699999 777665433210 1
Q ss_pred CCeEEEeeCCCCCC--CceEEEEeecCcEE-EEeecccchhhhc
Q 000080 2343 GINVVVWDTLAPPT--SSRASITCHEGLYD-LFLPLKLLNFALS 2383 (2389)
Q Consensus 2343 D~TVrLWD~l~~tg--~~v~sL~GH~~~V~-svA~~~~~~~~~s 2383 (2389)
...|..+++ .++ +...-+++..+... .+..+++++|.+-
T Consensus 198 ~~~v~~h~l--gt~~~~d~lv~~e~~~~~~~~~~~s~d~~~l~i 239 (686)
T PRK10115 198 PYQVWRHTI--GTPASQDELVYEEKDDTFYVSLHKTTSKHYVVI 239 (686)
T ss_pred CCEEEEEEC--CCChhHCeEEEeeCCCCEEEEEEEcCCCCEEEE
Confidence 135777776 344 33334444334344 4445557877653
No 426
>PF07676 PD40: WD40-like Beta Propeller Repeat; InterPro: IPR011659 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events. This region appears to be related to the IPR001680 from INTERPRO repeat. This model is likely to miss copies within a sequence.; PDB: 2HQS_D 1C5K_A 2IVZ_A 2W8B_D 3IAX_A 1CRZ_A 1N6F_D 1N6D_C 1N6E_C 1K32_A ....
Probab=22.38 E-value=1.2e+02 Score=26.10 Aligned_cols=22 Identities=14% Similarity=0.126 Sum_probs=16.6
Q ss_pred ccceEEEEeecCCCCeEEEEec
Q 000080 144 QGTKVEAIEWTGSGDGIVAGGM 165 (2389)
Q Consensus 144 hssTV~sIAWSpdG~rLaSggd 165 (2389)
....-...+|||||++|+-++.
T Consensus 7 ~~~~~~~p~~SpDGk~i~f~s~ 28 (39)
T PF07676_consen 7 SPGDDGSPAWSPDGKYIYFTSN 28 (39)
T ss_dssp SSSSEEEEEE-TTSSEEEEEEE
T ss_pred CCccccCEEEecCCCEEEEEec
Confidence 3446688999999999996665
No 427
>PF08728 CRT10: CRT10; InterPro: IPR014839 CRT10 is a transcriptional regulator of ribonucleotide reductase (RNR) genes []. RNR catalyses the rate limiting step in dNTP synthesis. Mutations in CRT10 have been shown to enhance hydroxyurea resistance [].
Probab=21.37 E-value=2e+02 Score=40.10 Aligned_cols=74 Identities=19% Similarity=0.354 Sum_probs=54.5
Q ss_pred eeEEEEEEc--CCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-----CC-EEEEEeC
Q 000080 2220 ISTRAFSSH--PLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-----GH-RFASAAL 2291 (2389)
Q Consensus 2220 i~VrsVAFs--PdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-----G~-~LASgS~ 2291 (2389)
.++|.+++| ...++||.++.-..|.+|-+..... +.+. .+.| -|.+-|-+|.|-++ |. ++++++-
T Consensus 164 ~SaWGLdIh~~~~~rlIAVSsNs~~VTVFaf~l~~~-r~~~-~~s~-----~~~hNIP~VSFl~~~~d~~G~v~v~a~dI 236 (717)
T PF08728_consen 164 ASAWGLDIHDYKKSRLIAVSSNSQEVTVFAFALVDE-RFYH-VPSH-----QHSHNIPNVSFLDDDLDPNGHVKVVATDI 236 (717)
T ss_pred CceeEEEEEecCcceEEEEecCCceEEEEEEecccc-cccc-cccc-----ccccCCCeeEeecCCCCCccceEEEEEec
Confidence 377999999 8899999999999999998865321 1111 0112 13456888888654 33 8999999
Q ss_pred CCcEEEeeC
Q 000080 2292 DGTVCTWQL 2300 (2389)
Q Consensus 2292 DgTVkLWDl 2300 (2389)
.|.+-+|++
T Consensus 237 ~G~v~~~~I 245 (717)
T PF08728_consen 237 SGEVWTFKI 245 (717)
T ss_pred cCcEEEEEE
Confidence 999999888
No 428
>TIGR02917 PEP_TPR_lipo putative PEP-CTERM system TPR-repeat lipoprotein. This protein family occurs in strictly within a subset of Gram-negative bacterial species with the proposed PEP-CTERM/exosortase system, analogous to the LPXTG/sortase system common in Gram-positive bacteria. This protein occurs in a species if and only if a transmembrane histidine kinase (TIGR02916) and a DNA-binding response regulator (TIGR02915) also occur. The present of tetratricopeptide repeats (TPR) suggests protein-protein interaction, possibly for the regulation of PEP-CTERM protein expression, since many PEP-CTERM proteins in these genomes are preceded by a proposed DNA binding site for the response regulator.
Probab=21.23 E-value=8.2e+02 Score=33.15 Aligned_cols=65 Identities=18% Similarity=0.217 Sum_probs=38.8
Q ss_pred HHHHHHHHHHhcCCChhhhhcccCCCCCCCCCCccccccCCCcccccccccCCCCCCCccccccccccccccccccccHH
Q 000080 1463 AALMRATALNRCGLPLEALDCLSSSPSTIGGTDQESVLNIGHSHILPEILKPSAATGSSNWLLRDVALHLESCAKLDLSL 1542 (2389)
Q Consensus 1463 ~~l~~a~~l~RmGC~lLALdll~~s~~~~~~~~~~s~~~~~~~~~~~~~~~~~~~~~~~nw~~~~~~~~~~~~~~~~~~~ 1542 (2389)
.....+..+.+.|-.-.|++.+.+.+.. .|... .-|+ ..+..+-...+.+.|.
T Consensus 195 ~~~~~~~~~~~~g~~~~A~~~~~~a~~~----------------------~p~~~---~~~~--~~~~~~~~~g~~~~A~ 247 (899)
T TIGR02917 195 ALLLKGDLLLSLGNIELALAAYRKAIAL----------------------RPNNP---AVLL--ALATILIEAGEFEEAE 247 (899)
T ss_pred HHHHHHHHHHhcCCHHHHHHHHHHHHhh----------------------CCCCH---HHHH--HHHHHHHHcCCHHHHH
Confidence 4455566678888888888888764321 11100 0111 1222233456788888
Q ss_pred HHHHHHhhcCCC
Q 000080 1543 QYFSKLIRDHPS 1554 (2389)
Q Consensus 1543 ~~~s~~~~~~~~ 1554 (2389)
+++.++++..|.
T Consensus 248 ~~~~~~~~~~~~ 259 (899)
T TIGR02917 248 KHADALLKKAPN 259 (899)
T ss_pred HHHHHHHHhCCC
Confidence 888888887764
No 429
>PF07676 PD40: WD40-like Beta Propeller Repeat; InterPro: IPR011659 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events. This region appears to be related to the IPR001680 from INTERPRO repeat. This model is likely to miss copies within a sequence.; PDB: 2HQS_D 1C5K_A 2IVZ_A 2W8B_D 3IAX_A 1CRZ_A 1N6F_D 1N6D_C 1N6E_C 1K32_A ....
Probab=21.07 E-value=2.2e+02 Score=24.62 Aligned_cols=30 Identities=7% Similarity=0.067 Sum_probs=20.0
Q ss_pred cCCCeeEEEEecCCCCEEEEeecCCCC--CeEEEe
Q 000080 2317 FSSHAMDVSYITSSGSVIAAAGHSSNG--INVVVW 2349 (2389)
Q Consensus 2317 Hs~~V~sVAFSP~DGslLASAG~sS~D--~TVrLW 2349 (2389)
....-...+||| ||+.|+-++ ..+ +.-.||
T Consensus 7 ~~~~~~~p~~Sp-DGk~i~f~s--~~~~~g~~diy 38 (39)
T PF07676_consen 7 SPGDDGSPAWSP-DGKYIYFTS--NRNDRGSFDIY 38 (39)
T ss_dssp SSSSEEEEEE-T-TSSEEEEEE--ECT--SSEEEE
T ss_pred CCccccCEEEec-CCCEEEEEe--cCCCCCCcCEE
Confidence 345566789999 999999764 344 555555
No 430
>PRK13615 lipoprotein LpqB; Provisional
Probab=20.86 E-value=6e+02 Score=34.92 Aligned_cols=114 Identities=11% Similarity=0.021 Sum_probs=62.1
Q ss_pred eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080 2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus 2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
+...+.+.+++|+.+|.-..++.++++..+ +.....+ .+. ..+.=.|+++| .+=++..+...++..
T Consensus 334 ~~~~s~avS~dg~~~A~v~~~~~l~vg~~~-~~~~~~~---~~~---------~Lt~PS~d~~g-~vWtv~~g~~~~l~~ 399 (557)
T PRK13615 334 LQADAATLSADGRQAAVRNASGVWSVGDGD-RDAVLLD---TRP---------GLVAPSLDAQG-YVWSTPASDPRGLVA 399 (557)
T ss_pred cccccceEcCCCceEEEEcCCceEEEecCC-Ccceeec---cCC---------ccccCcCcCCC-CEEEEeCCCceEEEE
Confidence 344778999999999988888889998765 3322222 122 23333455555 222322323344444
Q ss_pred CCCCCccCcccceeeee-cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080 2300 LEVGGRSNVRPMESCLC-FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus 2300 l~tggrs~~k~l~tl~g-Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
....+. ...+ .... -.+.|.++..|+ ||.++|----...+++|.|=-+
T Consensus 400 ~~~~G~--~~~v-~v~~~~~~~I~~lrvSr-DG~R~Avi~~~~g~~~V~va~V 448 (557)
T PRK13615 400 WGPDGV--GHPV-AVSWTATGRVVSLEVAR-DGARVLVQLETGAGPQLLVASI 448 (557)
T ss_pred ecCCCc--eEEe-eccccCCCeeEEEEeCC-CccEEEEEEecCCCCEEEEEEE
Confidence 332111 0111 1111 225799999999 9998886321123456666554
No 431
>PHA02713 hypothetical protein; Provisional
Probab=20.16 E-value=9.5e+02 Score=32.75 Aligned_cols=85 Identities=13% Similarity=0.097 Sum_probs=44.5
Q ss_pred eeeccccccccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCCC-----cEEEeecCCCceeeEecccCCCCCCCCCC
Q 000080 2196 ASALGWETQDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSNT-----HIYLWEFGKDKATATYGVLPAANVPPPYA 2270 (2389)
Q Consensus 2196 Asg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~Dg-----TIRLWDl~tGk~l~Tl~vl~gh~~p~~GH 2270 (2389)
.++.-||.....|....+...... ...+..-+|+++|.||.|+ +|..||..+++=.. .. .||.+
T Consensus 320 ~~v~~Yd~~~n~W~~~~~m~~~R~---~~~~~~~~g~IYviGG~~~~~~~~sve~Ydp~~~~W~~-~~-----~mp~~-- 388 (557)
T PHA02713 320 NKVYKINIENKIHVELPPMIKNRC---RFSLAVIDDTIYAIGGQNGTNVERTIECYTMGDDKWKM-LP-----DMPIA-- 388 (557)
T ss_pred ceEEEEECCCCeEeeCCCCcchhh---ceeEEEECCEEEEECCcCCCCCCceEEEEECCCCeEEE-CC-----CCCcc--
Confidence 344556666666654332222111 1122334688999999764 48889987664211 11 12211
Q ss_pred CCCEEEEEECCCCCEEEEEeCCC
Q 000080 2271 LASISALQFDHYGHRFASAALDG 2293 (2389)
Q Consensus 2271 ~~~V~sVaFSPDG~~LASgS~Dg 2293 (2389)
......++ -+|+..+.|+.++
T Consensus 389 r~~~~~~~--~~g~IYviGG~~~ 409 (557)
T PHA02713 389 LSSYGMCV--LDQYIYIIGGRTE 409 (557)
T ss_pred cccccEEE--ECCEEEEEeCCCc
Confidence 11122233 3799999998763
Done!